{
  "best_global_step": null,
  "best_metric": null,
  "best_model_checkpoint": null,
  "epoch": 0.5575171901133619,
  "eval_steps": 200,
  "global_step": 12000,
  "is_hyper_param_search": false,
  "is_local_process_zero": true,
  "is_world_process_zero": true,
  "log_history": [
    {
      "dense_tokens": 24586.0,
      "epoch": 4.6459765842780154e-05,
      "grad_norm": 1.1734809875488281,
      "learning_rate": 0.0,
      "loss": 0.1711,
      "mae_dtheta": 0.04884776100516319,
      "mae_dx": 0.01846596971154213,
      "mae_dy": 0.0066437493078410625,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999989867210388,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 125.2134780883789,
      "model/head/act_norm_mean": 84.26736610814145,
      "model/head/act_norm_min": 52.02541732788086,
      "model/head/act_over_embed": 57.909322913025996,
      "model/head/grad_frac": 0.07214808464050293,
      "model/head/grad_norm": 0.07214801013469696,
      "model/head/grad_zero_frac": 0.00012976415746379644,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6796104029605263,
      "model/head/update_ratio": 0.001265689730644226,
      "model/head/weight_delta": 0.0,
      "model/head/weight_delta_rel": 0.0,
      "model/head/weight_norm": 57.0029182434082,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4086979329586029,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4086979329586029,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4086979329586029,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28086104581948446,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09778720885515213,
      "model/modality_embedder.encoders.pose/grad_norm": 0.09778711199760437,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.003195009892806411,
      "model/modality_embedder.encoders.pose/weight_delta": 0.0,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0,
      "model/modality_embedder.encoders.pose/weight_norm": 30.606201171875,
      "model/modality_embedder/grad_frac": 0.09778720885515213,
      "model/modality_embedder/grad_norm": 0.09778711199760437,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.003195009892806411,
      "model/modality_embedder/weight_delta": 0.0,
      "model/modality_embedder/weight_delta_rel": 0.0,
      "model/modality_embedder/weight_norm": 30.606201171875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 68.9273910522461,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 20.664093501984127,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.081602096557617,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.200558514854874,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05746779218316078,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.057467732578516006,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020941589027643204,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.0,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.44191551208496,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 70.59477996826172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 21.58352097692147,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.61368465423584,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 14.832397683447455,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0595892108976841,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05958915129303932,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002064214553683996,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.0,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.867712020874023,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 72.56916809082031,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 23.23222444131161,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.893755912780762,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 15.965402139581382,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06209995225071907,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.062099888920784,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002085197949782014,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.0,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.781291961669922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 73.53369140625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 25.32047240497076,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.9096097946167,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 17.40046569069341,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06736405938863754,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06736399233341217,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002302181674167514,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.0,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.260936737060547,
      "model/normalizer/grad_frac": 0.2397085577249527,
      "model/normalizer/grad_norm": 0.2397083193063736,
      "model/normalizer/grad_zero_frac": 0.00015362599515356123,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0030873040668666363,
      "model/normalizer/weight_delta": 0.0,
      "model/normalizer/weight_delta_rel": 0.0,
      "model/normalizer/weight_norm": 77.64324951171875,
      "pose_mae_dtheta": 0.47308751940727234,
      "pose_mae_dx": 0.1571182757616043,
      "pose_mae_dy": 0.10752289742231369,
      "pose_rmse_dtheta": 0.7098652720451355,
      "pose_rmse_dx": 0.3067905902862549,
      "pose_rmse_dy": 0.24454368650913239,
      "pose_rmse_mean": 0.42039987444877625,
      "rmse_dtheta": 0.06546775251626968,
      "rmse_dx": 0.032095473259687424,
      "rmse_dy": 0.012520798482000828,
      "rmse_mean": 0.03669467568397522,
      "rotation_flip": 0.005192107986658812,
      "sparse_tokens": 20535.0,
      "step": 1,
      "turn_loss": 0.46482959389686584,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 9.291953168556031e-05,
      "grad_norm": 2.073781967163086,
      "learning_rate": 8.333333333333334e-08,
      "loss": 0.4282,
      "mae_dtheta": 0.045693717896938324,
      "mae_dx": 0.025959262624382973,
      "mae_dy": 0.007914476096630096,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.999999463558197,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.49954223632812,
      "model/head/act_norm_mean": 85.46222478693181,
      "model/head/act_norm_min": 57.841182708740234,
      "model/head/act_over_embed": 58.73044098353394,
      "model/head/grad_frac": 0.11955825239419937,
      "model/head/grad_norm": 0.119558185338974,
      "model/head/grad_zero_frac": 0.00015673224697820842,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6872336647727273,
      "model/head/update_ratio": 0.0020974045619368553,
      "model/head/weight_delta": 0.0,
      "model/head/weight_delta_rel": 0.0,
      "model/head/weight_norm": 57.0029182434082,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4086979329586029,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4086979329586029,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4086979329586029,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28086104581948446,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10383419692516327,
      "model/modality_embedder.encoders.pose/grad_norm": 0.10383414477109909,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.003392585087567568,
      "model/modality_embedder.encoders.pose/weight_delta": 0.0,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0,
      "model/modality_embedder.encoders.pose/weight_norm": 30.606201171875,
      "model/modality_embedder/grad_frac": 0.10383419692516327,
      "model/modality_embedder/grad_norm": 0.10383414477109909,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.003392585087567568,
      "model/modality_embedder/weight_delta": 0.0,
      "model/modality_embedder/weight_delta_rel": 0.0,
      "model/modality_embedder/weight_norm": 30.606201171875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 76.90137481689453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 20.82032095508658,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.05054759979248,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.30791948325134,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08420940488576889,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.08420936018228531,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0030686401296406984,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.0,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.44191551208496,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.60767364501953,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 21.723142417478353,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.561418533325195,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 14.928346844554666,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09270278364419937,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.09270273149013519,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0032112947665154934,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.0,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.867712020874023,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.41229248046875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 23.328939506673883,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.555707931518555,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.031865637959044,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09076250344514847,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.09076245129108429,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0030476332176476717,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.0,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.781291961669922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.17375946044922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 25.411069399350648,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.241776466369629,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 17.46272479341369,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08743645250797272,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08743640780448914,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0029881615191698074,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.0,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.260936737060547,
      "model/normalizer/grad_frac": 0.35704827308654785,
      "model/normalizer/grad_norm": 0.3570480942726135,
      "model/normalizer/grad_zero_frac": 0.00016426164074800909,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004598572384566069,
      "model/normalizer/weight_delta": 0.0,
      "model/normalizer/weight_delta_rel": 0.0,
      "model/normalizer/weight_norm": 77.64324951171875,
      "pose_mae_dtheta": 0.4506765305995941,
      "pose_mae_dx": 0.2770242989063263,
      "pose_mae_dy": 0.10560885071754456,
      "pose_rmse_dtheta": 0.6531251072883606,
      "pose_rmse_dx": 0.44514453411102295,
      "pose_rmse_dy": 0.20937921106815338,
      "pose_rmse_mean": 0.4358829855918884,
      "rmse_dtheta": 0.06157481670379639,
      "rmse_dx": 0.039637286216020584,
      "rmse_dy": 0.016612639650702477,
      "rmse_mean": 0.0392749160528183,
      "rotation_flip": 0.013916500844061375,
      "sparse_tokens": 10427.0,
      "step": 2,
      "turn_loss": 0.6069968938827515,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.00013937929752834045,
      "grad_norm": 0.6310847997665405,
      "learning_rate": 1.6666666666666668e-07,
      "loss": 0.1722,
      "mae_dtheta": 0.01444076094776392,
      "mae_dx": 0.0030703949742019176,
      "mae_dy": 0.003359681461006403,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6310849785804749,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.37498474121094,
      "model/head/act_norm_mean": 106.98132694128788,
      "model/head/act_norm_min": 67.48224639892578,
      "model/head/act_over_embed": 73.51856944901593,
      "model/head/grad_frac": 0.10465846210718155,
      "model/head/grad_norm": 0.06604838371276855,
      "model/head/grad_zero_frac": 0.00017608582857064903,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6761758207070707,
      "model/head/update_ratio": 0.0011586842592805624,
      "model/head/weight_delta": 0.0011114715598523617,
      "model/head/weight_delta_rel": 1.949850411619991e-05,
      "model/head/weight_norm": 57.0029182434082,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.40877923369407654,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.40869903564453125,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.408623605966568,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28086180359557794,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07359252125024796,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04644313454627991,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5352876261210763,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015174419386312366,
      "model/modality_embedder.encoders.pose/weight_delta": 0.00046282491530291736,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 1.5121932847250719e-05,
      "model/modality_embedder.encoders.pose/weight_norm": 30.606203079223633,
      "model/modality_embedder/grad_frac": 0.07359252125024796,
      "model/modality_embedder/grad_norm": 0.04644313454627991,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5352876261210763,
      "model/modality_embedder/update_ratio": 0.0015174419386312366,
      "model/modality_embedder/weight_delta": 0.00046282491530291736,
      "model/modality_embedder/weight_delta_rel": 1.5121932847250719e-05,
      "model/modality_embedder/weight_norm": 30.606203079223633,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.60922241210938,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.941638608305276,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.970407485961914,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.765708834631997,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0909745991230011,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05741270259022713,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020921537652611732,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.00029343419009819627,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 1.0692919204302598e-05,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.441913604736328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.9695816040039,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.0244708994709,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.296775817871094,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.509841322756646,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08300785720348358,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05238501355051994,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018146575894206762,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.0002933428331743926,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 1.0161625141336117e-05,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.867712020874023,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.87255096435547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.98788229517396,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.286426544189453,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.859116015630885,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08352981507778168,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05271441116929054,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001770051079802215,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.00028863531770184636,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 9.691833838587627e-06,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.781293869018555,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.6951904296875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.96940135481802,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.00332260131836,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.220834464692,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08299518376588821,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05237701162695885,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001789997797459364,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.0002894248173106462,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 9.891166882880498e-06,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.260936737060547,
      "model/normalizer/grad_frac": 0.2999493479728699,
      "model/normalizer/grad_norm": 0.1892935335636139,
      "model/normalizer/grad_zero_frac": 0.0001985320559469983,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002437991090118885,
      "model/normalizer/weight_delta": 0.0006021840963512659,
      "model/normalizer/weight_delta_rel": 7.755782462481875e-06,
      "model/normalizer/weight_norm": 77.64324188232422,
      "pose_mae_dtheta": 0.10002905130386353,
      "pose_mae_dx": 0.0320400707423687,
      "pose_mae_dy": 0.040319282561540604,
      "pose_rmse_dtheta": 0.2166593372821808,
      "pose_rmse_dx": 0.07807600498199463,
      "pose_rmse_dy": 0.09941985458135605,
      "pose_rmse_mean": 0.13138507306575775,
      "rmse_dtheta": 0.02679550275206566,
      "rmse_dx": 0.009027413092553616,
      "rmse_dy": 0.008318089880049229,
      "rmse_mean": 0.014713669195771217,
      "rotation_flip": 0.00935672502964735,
      "sparse_tokens": 32105.0,
      "step": 3,
      "turn_loss": 0.12290740758180618,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.00018583906337112061,
      "grad_norm": 0.7989590764045715,
      "learning_rate": 2.5000000000000004e-07,
      "loss": 0.1734,
      "mae_dtheta": 0.012661178596317768,
      "mae_dx": 0.003112092614173889,
      "mae_dy": 0.0028540713246911764,
      "pose_mae_dtheta": 0.08579929172992706,
      "pose_mae_dx": 0.034394826740026474,
      "pose_mae_dy": 0.028728986158967018,
      "pose_rmse_dtheta": 0.2109123319387436,
      "pose_rmse_dx": 0.08598796278238297,
      "pose_rmse_dy": 0.07129782438278198,
      "pose_rmse_mean": 0.12273271381855011,
      "rmse_dtheta": 0.028093667700886726,
      "rmse_dx": 0.008545436896383762,
      "rmse_dy": 0.006785173434764147,
      "rmse_mean": 0.014474759809672832,
      "rotation_flip": 0.004092071671038866,
      "sparse_tokens": 32073.0,
      "step": 4,
      "turn_loss": 0.10874097049236298,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.00023229882921390075,
      "grad_norm": 0.6271119713783264,
      "learning_rate": 3.3333333333333335e-07,
      "loss": 0.1819,
      "mae_dtheta": 0.014030370861291885,
      "mae_dx": 0.003327880520373583,
      "mae_dy": 0.002942049643024802,
      "pose_mae_dtheta": 0.09968498349189758,
      "pose_mae_dx": 0.04001517966389656,
      "pose_mae_dy": 0.04113457351922989,
      "pose_rmse_dtheta": 0.18651074171066284,
      "pose_rmse_dx": 0.09659992903470993,
      "pose_rmse_dy": 0.09126316756010056,
      "pose_rmse_mean": 0.12479128688573837,
      "rmse_dtheta": 0.026036232709884644,
      "rmse_dx": 0.009749853052198887,
      "rmse_dy": 0.00581133458763361,
      "rmse_mean": 0.01386580616235733,
      "rotation_flip": 0.002665651263669133,
      "sparse_tokens": 32121.0,
      "step": 5,
      "turn_loss": 0.13135358691215515,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0002787585950566809,
      "grad_norm": 0.6688841581344604,
      "learning_rate": 4.1666666666666667e-07,
      "loss": 0.1015,
      "mae_dtheta": 0.010326836258172989,
      "mae_dx": 0.001755366800352931,
      "mae_dy": 0.0022351229563355446,
      "pose_mae_dtheta": 0.06977023184299469,
      "pose_mae_dx": 0.026448596268892288,
      "pose_mae_dy": 0.033728864043951035,
      "pose_rmse_dtheta": 0.15672439336776733,
      "pose_rmse_dx": 0.06016167625784874,
      "pose_rmse_dy": 0.07861322164535522,
      "pose_rmse_mean": 0.09849976748228073,
      "rmse_dtheta": 0.02184431627392769,
      "rmse_dx": 0.0050538089126348495,
      "rmse_dy": 0.004613013938069344,
      "rmse_mean": 0.01050371304154396,
      "rotation_flip": 0.0041135335341095924,
      "sparse_tokens": 32089.0,
      "step": 6,
      "turn_loss": 0.08125079423189163,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.0003252183608994611,
      "grad_norm": 0.9051878452301025,
      "learning_rate": 5.000000000000001e-07,
      "loss": 0.2343,
      "mae_dtheta": 0.008414660580456257,
      "mae_dx": 0.0021038393024355173,
      "mae_dy": 0.002109172288328409,
      "pose_mae_dtheta": 0.05617531016469002,
      "pose_mae_dx": 0.022571656852960587,
      "pose_mae_dy": 0.023140693083405495,
      "pose_rmse_dtheta": 0.12490370869636536,
      "pose_rmse_dx": 0.061316873878240585,
      "pose_rmse_dy": 0.0533214770257473,
      "pose_rmse_mean": 0.07984735816717148,
      "rmse_dtheta": 0.019123582169413567,
      "rmse_dx": 0.006379660218954086,
      "rmse_dy": 0.004789536818861961,
      "rmse_mean": 0.010097593069076538,
      "rotation_flip": 0.006983240135014057,
      "sparse_tokens": 32073.0,
      "step": 7,
      "turn_loss": 0.06884046643972397,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.00037167812674224123,
      "grad_norm": 0.813258171081543,
      "learning_rate": 5.833333333333334e-07,
      "loss": 0.193,
      "mae_dtheta": 0.009465857408940792,
      "mae_dx": 0.002147432416677475,
      "mae_dy": 0.002151909749954939,
      "pose_mae_dtheta": 0.05884436145424843,
      "pose_mae_dx": 0.0255548357963562,
      "pose_mae_dy": 0.02678615041077137,
      "pose_rmse_dtheta": 0.11455214023590088,
      "pose_rmse_dx": 0.06565532833337784,
      "pose_rmse_dy": 0.060348525643348694,
      "pose_rmse_mean": 0.08018533140420914,
      "rmse_dtheta": 0.018756214529275894,
      "rmse_dx": 0.006041526794433594,
      "rmse_dy": 0.004625162109732628,
      "rmse_mean": 0.009807635098695755,
      "rotation_flip": 0.004446420818567276,
      "sparse_tokens": 32105.0,
      "step": 8,
      "turn_loss": 0.0849689170718193,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.00041813789258502137,
      "grad_norm": 0.5994268655776978,
      "learning_rate": 6.666666666666667e-07,
      "loss": 0.1279,
      "mae_dtheta": 0.012151651084423065,
      "mae_dx": 0.003234994364902377,
      "mae_dy": 0.003331034677103162,
      "pose_mae_dtheta": 0.078743577003479,
      "pose_mae_dx": 0.030994325876235962,
      "pose_mae_dy": 0.0363585390150547,
      "pose_rmse_dtheta": 0.16558179259300232,
      "pose_rmse_dx": 0.07466369867324829,
      "pose_rmse_dy": 0.09042897820472717,
      "pose_rmse_mean": 0.11022482812404633,
      "rmse_dtheta": 0.023101547732949257,
      "rmse_dx": 0.009742947295308113,
      "rmse_dy": 0.006801980081945658,
      "rmse_mean": 0.013215492479503155,
      "rotation_flip": 0.0046744574792683125,
      "sparse_tokens": 32137.0,
      "step": 9,
      "turn_loss": 0.11345169693231583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.0004645976584278015,
      "grad_norm": 0.9167852401733398,
      "learning_rate": 7.5e-07,
      "loss": 0.1927,
      "mae_dtheta": 0.06167762726545334,
      "mae_dx": 0.013718917965888977,
      "mae_dy": 0.004359228070825338,
      "pose_mae_dtheta": 0.6246667504310608,
      "pose_mae_dx": 0.12713199853897095,
      "pose_mae_dy": 0.046864014118909836,
      "pose_rmse_dtheta": 0.8763774037361145,
      "pose_rmse_dx": 0.2261732667684555,
      "pose_rmse_dy": 0.12716923654079437,
      "pose_rmse_mean": 0.40990662574768066,
      "rmse_dtheta": 0.07910331338644028,
      "rmse_dx": 0.024181481450796127,
      "rmse_dy": 0.010250364430248737,
      "rmse_mean": 0.037845052778720856,
      "rotation_flip": 0.019710905849933624,
      "sparse_tokens": 12357.0,
      "step": 10,
      "turn_loss": 0.5118259787559509,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.0005110574242705816,
      "grad_norm": 0.4845920205116272,
      "learning_rate": 8.333333333333333e-07,
      "loss": 0.1321,
      "mae_dtheta": 0.009355872869491577,
      "mae_dx": 0.0031340382993221283,
      "mae_dy": 0.0029546942096203566,
      "pose_mae_dtheta": 0.06674753129482269,
      "pose_mae_dx": 0.03822491317987442,
      "pose_mae_dy": 0.029725726693868637,
      "pose_rmse_dtheta": 0.14222878217697144,
      "pose_rmse_dx": 0.10130857676267624,
      "pose_rmse_dy": 0.06607578694820404,
      "pose_rmse_mean": 0.1032043918967247,
      "rmse_dtheta": 0.01902681402862072,
      "rmse_dx": 0.008615003898739815,
      "rmse_dy": 0.007012167479842901,
      "rmse_mean": 0.011551328003406525,
      "rotation_flip": 0.003021148033440113,
      "sparse_tokens": 32105.0,
      "step": 11,
      "turn_loss": 0.10375479608774185,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.0005575171901133618,
      "grad_norm": 0.38475099205970764,
      "learning_rate": 9.166666666666666e-07,
      "loss": 0.084,
      "mae_dtheta": 0.00855293869972229,
      "mae_dx": 0.0056383246555924416,
      "mae_dy": 0.0013021432096138597,
      "pose_mae_dtheta": 0.0648631900548935,
      "pose_mae_dx": 0.04967721179127693,
      "pose_mae_dy": 0.01897192932665348,
      "pose_rmse_dtheta": 0.19296802580356598,
      "pose_rmse_dx": 0.15489314496517181,
      "pose_rmse_dy": 0.06321632117033005,
      "pose_rmse_mean": 0.1370258331298828,
      "rmse_dtheta": 0.023402409628033638,
      "rmse_dx": 0.015747498720884323,
      "rmse_dy": 0.004500816576182842,
      "rmse_mean": 0.014550242573022842,
      "rotation_flip": 0.005376344081014395,
      "sparse_tokens": 32105.0,
      "step": 12,
      "turn_loss": 0.09619376808404922,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0006039769559561419,
      "grad_norm": 0.4918479323387146,
      "learning_rate": 1.0000000000000002e-06,
      "loss": 0.093,
      "mae_dtheta": 0.0114281065762043,
      "mae_dx": 0.0031709501054137945,
      "mae_dy": 0.0033720198553055525,
      "pose_mae_dtheta": 0.07991117238998413,
      "pose_mae_dx": 0.03963463008403778,
      "pose_mae_dy": 0.03875773772597313,
      "pose_rmse_dtheta": 0.1685866117477417,
      "pose_rmse_dx": 0.10113974660634995,
      "pose_rmse_dy": 0.08703736960887909,
      "pose_rmse_mean": 0.11892124265432358,
      "rmse_dtheta": 0.02226109243929386,
      "rmse_dx": 0.009274465031921864,
      "rmse_dy": 0.0074444725178182125,
      "rmse_mean": 0.01299334317445755,
      "rotation_flip": 0.005709935445338488,
      "sparse_tokens": 32089.0,
      "step": 13,
      "turn_loss": 0.10116230696439743,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0006504367217989222,
      "grad_norm": 0.5330641865730286,
      "learning_rate": 1.0833333333333335e-06,
      "loss": 0.162,
      "mae_dtheta": 0.012806328944861889,
      "mae_dx": 0.002889469265937805,
      "mae_dy": 0.002609668532386422,
      "pose_mae_dtheta": 0.08913885802030563,
      "pose_mae_dx": 0.03468884155154228,
      "pose_mae_dy": 0.03781507909297943,
      "pose_rmse_dtheta": 0.17258243262767792,
      "pose_rmse_dx": 0.08683772385120392,
      "pose_rmse_dy": 0.08461661636829376,
      "pose_rmse_mean": 0.11467891931533813,
      "rmse_dtheta": 0.024747751653194427,
      "rmse_dx": 0.009036866016685963,
      "rmse_dy": 0.004984135273844004,
      "rmse_mean": 0.012922918424010277,
      "rotation_flip": 0.008909630589187145,
      "sparse_tokens": 32089.0,
      "step": 14,
      "turn_loss": 0.10557925701141357,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.0006968964876417023,
      "grad_norm": 0.7899529933929443,
      "learning_rate": 1.1666666666666668e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.07786419987678528,
      "mae_dx": 0.0250728540122509,
      "mae_dy": 0.008720741607248783,
      "pose_mae_dtheta": 0.7689370512962341,
      "pose_mae_dx": 0.2257593870162964,
      "pose_mae_dy": 0.10653874278068542,
      "pose_rmse_dtheta": 1.0813273191452026,
      "pose_rmse_dx": 0.37405723333358765,
      "pose_rmse_dy": 0.21717268228530884,
      "pose_rmse_mean": 0.5575190782546997,
      "rmse_dtheta": 0.09648706763982773,
      "rmse_dx": 0.03769483044743538,
      "rmse_dy": 0.015612167306244373,
      "rmse_mean": 0.0499313585460186,
      "rotation_flip": 0.018633540719747543,
      "sparse_tokens": 5614.0,
      "step": 15,
      "turn_loss": 0.5453914403915405,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.0007433562534844825,
      "grad_norm": 0.6803525686264038,
      "learning_rate": 1.25e-06,
      "loss": 0.2111,
      "mae_dtheta": 0.025975648313760757,
      "mae_dx": 0.01148300338536501,
      "mae_dy": 0.005270739085972309,
      "pose_mae_dtheta": 0.17842018604278564,
      "pose_mae_dx": 0.09651996195316315,
      "pose_mae_dy": 0.06563020497560501,
      "pose_rmse_dtheta": 0.29921388626098633,
      "pose_rmse_dx": 0.2277994453907013,
      "pose_rmse_dy": 0.12083820253610611,
      "pose_rmse_mean": 0.21595051884651184,
      "rmse_dtheta": 0.038927190005779266,
      "rmse_dx": 0.024648278951644897,
      "rmse_dy": 0.009850854054093361,
      "rmse_mean": 0.02447544038295746,
      "rotation_flip": 0.007418397814035416,
      "sparse_tokens": 12448.0,
      "step": 16,
      "turn_loss": 0.2517431676387787,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.0007898160193272626,
      "grad_norm": 0.826316773891449,
      "learning_rate": 1.3333333333333334e-06,
      "loss": 0.223,
      "mae_dtheta": 0.054993875324726105,
      "mae_dx": 0.022135987877845764,
      "mae_dy": 0.00791101809591055,
      "pose_mae_dtheta": 0.5025826692581177,
      "pose_mae_dx": 0.2063748985528946,
      "pose_mae_dy": 0.10018300265073776,
      "pose_rmse_dtheta": 0.7261443138122559,
      "pose_rmse_dx": 0.3570129871368408,
      "pose_rmse_dy": 0.22334390878677368,
      "pose_rmse_mean": 0.4355003833770752,
      "rmse_dtheta": 0.07112758606672287,
      "rmse_dx": 0.03570055216550827,
      "rmse_dy": 0.01507632341235876,
      "rmse_mean": 0.040634822100400925,
      "rotation_flip": 0.02494576945900917,
      "sparse_tokens": 16470.0,
      "step": 17,
      "turn_loss": 0.5273743867874146,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 26527.0,
      "epoch": 0.0008362757851700427,
      "grad_norm": 0.7491921186447144,
      "learning_rate": 1.4166666666666667e-06,
      "loss": 0.161,
      "mae_dtheta": 0.06593712419271469,
      "mae_dx": 0.012282134033739567,
      "mae_dy": 0.0057664429768919945,
      "pose_mae_dtheta": 0.6632070541381836,
      "pose_mae_dx": 0.1144082322716713,
      "pose_mae_dy": 0.06911826133728027,
      "pose_rmse_dtheta": 0.9272003173828125,
      "pose_rmse_dx": 0.242039293050766,
      "pose_rmse_dy": 0.17158465087413788,
      "pose_rmse_mean": 0.44694143533706665,
      "rmse_dtheta": 0.08356643468141556,
      "rmse_dx": 0.024143647402524948,
      "rmse_dy": 0.012117106467485428,
      "rmse_mean": 0.03994239494204521,
      "rotation_flip": 0.011191046796739101,
      "sparse_tokens": 20936.0,
      "step": 18,
      "turn_loss": 0.5016612410545349,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.0008827355510128229,
      "grad_norm": 0.4505675733089447,
      "learning_rate": 1.5e-06,
      "loss": 0.1344,
      "mae_dtheta": 0.01367483101785183,
      "mae_dx": 0.0029888825956732035,
      "mae_dy": 0.003244625171646476,
      "pose_mae_dtheta": 0.10160454362630844,
      "pose_mae_dx": 0.03827168792486191,
      "pose_mae_dy": 0.04692370072007179,
      "pose_rmse_dtheta": 0.2131224125623703,
      "pose_rmse_dx": 0.10197514295578003,
      "pose_rmse_dy": 0.10799400508403778,
      "pose_rmse_mean": 0.14103053510189056,
      "rmse_dtheta": 0.02511407621204853,
      "rmse_dx": 0.009440870955586433,
      "rmse_dy": 0.006549748592078686,
      "rmse_mean": 0.013701565563678741,
      "rotation_flip": 0.007506914436817169,
      "sparse_tokens": 32073.0,
      "step": 19,
      "turn_loss": 0.09970671683549881,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.000929195316855603,
      "grad_norm": 0.5635379552841187,
      "learning_rate": 1.5833333333333333e-06,
      "loss": 0.2011,
      "mae_dtheta": 0.013271484524011612,
      "mae_dx": 0.0029638437554240227,
      "mae_dy": 0.002590095391497016,
      "pose_mae_dtheta": 0.09989290684461594,
      "pose_mae_dx": 0.0334128737449646,
      "pose_mae_dy": 0.032589904963970184,
      "pose_rmse_dtheta": 0.2510198652744293,
      "pose_rmse_dx": 0.0842670425772667,
      "pose_rmse_dy": 0.07634270191192627,
      "pose_rmse_mean": 0.13720987737178802,
      "rmse_dtheta": 0.02819664403796196,
      "rmse_dx": 0.008906223811209202,
      "rmse_dy": 0.005444386508315802,
      "rmse_mean": 0.014182417653501034,
      "rotation_flip": 0.005030181258916855,
      "sparse_tokens": 32169.0,
      "step": 20,
      "turn_loss": 0.09911922365427017,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.0009756550826983832,
      "grad_norm": 0.5868179798126221,
      "learning_rate": 1.6666666666666667e-06,
      "loss": 0.173,
      "mae_dtheta": 0.056784581393003464,
      "mae_dx": 0.023630531504750252,
      "mae_dy": 0.006645031739026308,
      "pose_mae_dtheta": 0.5029675364494324,
      "pose_mae_dx": 0.21523012220859528,
      "pose_mae_dy": 0.09354899078607559,
      "pose_rmse_dtheta": 0.7775501608848572,
      "pose_rmse_dx": 0.372932106256485,
      "pose_rmse_dy": 0.18622010946273804,
      "pose_rmse_mean": 0.44556745886802673,
      "rmse_dtheta": 0.07548385113477707,
      "rmse_dx": 0.036812856793403625,
      "rmse_dy": 0.012784543447196484,
      "rmse_mean": 0.041693754494190216,
      "rotation_flip": 0.01272727269679308,
      "sparse_tokens": 19266.0,
      "step": 21,
      "turn_loss": 0.49632421135902405,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.0010221148485411633,
      "grad_norm": 0.7310472726821899,
      "learning_rate": 1.75e-06,
      "loss": 0.1606,
      "mae_dtheta": 0.007496600970625877,
      "mae_dx": 0.0024379962123930454,
      "mae_dy": 0.00037182349478825927,
      "pose_mae_dtheta": 0.056952815502882004,
      "pose_mae_dx": 0.022239068523049355,
      "pose_mae_dy": 0.0049057696014642715,
      "pose_rmse_dtheta": 0.20544104278087616,
      "pose_rmse_dx": 0.05111446604132652,
      "pose_rmse_dy": 0.009861068800091743,
      "pose_rmse_mean": 0.08880552649497986,
      "rmse_dtheta": 0.0258506927639246,
      "rmse_dx": 0.0065775648690760136,
      "rmse_dy": 0.001130972639657557,
      "rmse_mean": 0.011186409741640091,
      "rotation_flip": 0.0013342228485271335,
      "sparse_tokens": 32217.0,
      "step": 22,
      "turn_loss": 0.06179332360625267,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.0010685746143839435,
      "grad_norm": 0.5329380631446838,
      "learning_rate": 1.8333333333333333e-06,
      "loss": 0.1642,
      "mae_dtheta": 0.02150016650557518,
      "mae_dx": 0.010804451070725918,
      "mae_dy": 0.0024268426932394505,
      "pose_mae_dtheta": 0.1659919172525406,
      "pose_mae_dx": 0.08904411643743515,
      "pose_mae_dy": 0.03594829514622688,
      "pose_rmse_dtheta": 0.3703177869319916,
      "pose_rmse_dx": 0.24145126342773438,
      "pose_rmse_dy": 0.11389773339033127,
      "pose_rmse_mean": 0.24188894033432007,
      "rmse_dtheta": 0.041221119463443756,
      "rmse_dx": 0.02518463134765625,
      "rmse_dy": 0.005653697531670332,
      "rmse_mean": 0.024019815027713776,
      "rotation_flip": 0.009845288470387459,
      "sparse_tokens": 18931.0,
      "step": 23,
      "turn_loss": 0.18021260201931,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.0011150343802267236,
      "grad_norm": 0.43956926465034485,
      "learning_rate": 1.916666666666667e-06,
      "loss": 0.1491,
      "mae_dtheta": 0.04077054187655449,
      "mae_dx": 0.017336713150143623,
      "mae_dy": 0.012565229088068008,
      "pose_mae_dtheta": 0.32637155055999756,
      "pose_mae_dx": 0.15444493293762207,
      "pose_mae_dy": 0.13082604110240936,
      "pose_rmse_dtheta": 0.583256721496582,
      "pose_rmse_dx": 0.2946673035621643,
      "pose_rmse_dy": 0.2682318687438965,
      "pose_rmse_mean": 0.382051944732666,
      "rmse_dtheta": 0.06007158011198044,
      "rmse_dx": 0.02948489598929882,
      "rmse_dy": 0.024222049862146378,
      "rmse_mean": 0.03792617842555046,
      "rotation_flip": 0.014644351787865162,
      "sparse_tokens": 7829.0,
      "step": 24,
      "turn_loss": 0.417426735162735,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.0011614941460695038,
      "grad_norm": 0.45737558603286743,
      "learning_rate": 2.0000000000000003e-06,
      "loss": 0.1281,
      "mae_dtheta": 0.008060576394200325,
      "mae_dx": 0.0021961487364023924,
      "mae_dy": 0.001198209822177887,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.45737552642822266,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.4805145263672,
      "model/head/act_norm_mean": 116.72224195075758,
      "model/head/act_norm_min": 65.43003845214844,
      "model/head/act_over_embed": 80.21261743940664,
      "model/head/grad_frac": 0.10664428770542145,
      "model/head/grad_norm": 0.04877648875117302,
      "model/head/grad_zero_frac": 0.0001776721910573542,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6743657275883839,
      "model/head/update_ratio": 0.0008556896355003119,
      "model/head/weight_delta": 0.14705954492092133,
      "model/head/weight_delta_rel": 0.002579859923571348,
      "model/head/weight_norm": 57.00254821777344,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4087366461753845,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.40867294911213836,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.40855005383491516,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28084387668629157,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12103688716888428,
      "model/modality_embedder.encoders.pose/grad_norm": 0.055359311401844025,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5242648062227074,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0018087467178702354,
      "model/modality_embedder.encoders.pose/weight_delta": 0.043820153921842575,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.001431741053238511,
      "model/modality_embedder.encoders.pose/weight_norm": 30.606447219848633,
      "model/modality_embedder/grad_frac": 0.12103688716888428,
      "model/modality_embedder/grad_norm": 0.055359311401844025,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5242648062227074,
      "model/modality_embedder/update_ratio": 0.0018087467178702354,
      "model/modality_embedder/weight_delta": 0.043820153921842575,
      "model/modality_embedder/weight_delta_rel": 0.001431741053238511,
      "model/modality_embedder/weight_norm": 30.606447219848633,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.27589416503906,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.86035453743787,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.847430229187012,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.39705902228596,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06319502741098404,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.028903860598802567,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010532838059589267,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.03903910517692566,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0014226085040718317,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.44166374206543,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.71770477294922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.99143217893218,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.32941722869873,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.174346166836564,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05877694487571716,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.026883136481046677,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009312565089203417,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.03823975846171379,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.001324655138887465,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.867595672607422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.75519561767578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.893450877825877,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.318598747253418,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.481431223695928,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.061582136899232864,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.028166161850094795,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009457636624574661,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.03718910366296768,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0012487404746934772,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.781394958496094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.47103118896484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.731892336059,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.963963508605957,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.744825405553836,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07748948037624359,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.035441793501377106,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012112038675695658,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.033421874046325684,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0011422010138630867,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.261625289916992,
      "model/normalizer/grad_frac": 0.296015202999115,
      "model/normalizer/grad_norm": 0.13539010286331177,
      "model/normalizer/grad_zero_frac": 0.000219803347135894,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017437402857467532,
      "model/normalizer/weight_delta": 0.07635970413684845,
      "model/normalizer/weight_delta_rel": 0.000983468722552061,
      "model/normalizer/weight_norm": 77.64350128173828,
      "pose_mae_dtheta": 0.061051145195961,
      "pose_mae_dx": 0.025030121207237244,
      "pose_mae_dy": 0.015953192487359047,
      "pose_rmse_dtheta": 0.18809814751148224,
      "pose_rmse_dx": 0.0638645589351654,
      "pose_rmse_dy": 0.04401838779449463,
      "pose_rmse_mean": 0.09866037219762802,
      "rmse_dtheta": 0.022205933928489685,
      "rmse_dx": 0.006796009838581085,
      "rmse_dy": 0.003005810547620058,
      "rmse_mean": 0.010669251903891563,
      "rotation_flip": 0.004793863743543625,
      "sparse_tokens": 32153.0,
      "step": 25,
      "turn_loss": 0.07161275297403336,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.0012079539119122839,
      "grad_norm": 0.3995516896247864,
      "learning_rate": 2.0833333333333334e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.016968796029686928,
      "mae_dx": 0.0031355172395706177,
      "mae_dy": 0.003612193977460265,
      "pose_mae_dtheta": 0.11033084243535995,
      "pose_mae_dx": 0.03852270916104317,
      "pose_mae_dy": 0.048441872000694275,
      "pose_rmse_dtheta": 0.2214900255203247,
      "pose_rmse_dx": 0.07870468497276306,
      "pose_rmse_dy": 0.11133010685443878,
      "pose_rmse_mean": 0.13717494904994965,
      "rmse_dtheta": 0.030927563086152077,
      "rmse_dx": 0.007901630364358425,
      "rmse_dy": 0.006882673595100641,
      "rmse_mean": 0.015237289480865002,
      "rotation_flip": 0.012056262232363224,
      "sparse_tokens": 32137.0,
      "step": 26,
      "turn_loss": 0.16207359731197357,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.001254413677755064,
      "grad_norm": 0.3964187800884247,
      "learning_rate": 2.166666666666667e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.03388528898358345,
      "mae_dx": 0.00591839337721467,
      "mae_dy": 0.005492102820426226,
      "pose_mae_dtheta": 0.23436251282691956,
      "pose_mae_dx": 0.03783058375120163,
      "pose_mae_dy": 0.03921189159154892,
      "pose_rmse_dtheta": 0.4459262192249298,
      "pose_rmse_dx": 0.0830337330698967,
      "pose_rmse_dy": 0.11612848937511444,
      "pose_rmse_mean": 0.21502947807312012,
      "rmse_dtheta": 0.05592108145356178,
      "rmse_dx": 0.012592446058988571,
      "rmse_dy": 0.014045828022062778,
      "rmse_mean": 0.02751978486776352,
      "rotation_flip": 0.008510638028383255,
      "sparse_tokens": 8137.0,
      "step": 27,
      "turn_loss": 0.20327606797218323,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0013008734435978444,
      "grad_norm": 0.4664570689201355,
      "learning_rate": 2.25e-06,
      "loss": 0.1792,
      "mae_dtheta": 0.014819012954831123,
      "mae_dx": 0.002355667296797037,
      "mae_dy": 0.0033386186696588993,
      "pose_mae_dtheta": 0.10954640060663223,
      "pose_mae_dx": 0.03907680884003639,
      "pose_mae_dy": 0.04549924656748772,
      "pose_rmse_dtheta": 0.23234757781028748,
      "pose_rmse_dx": 0.09850391745567322,
      "pose_rmse_dy": 0.10991959273815155,
      "pose_rmse_mean": 0.1469237059354782,
      "rmse_dtheta": 0.02836620807647705,
      "rmse_dx": 0.006662460975348949,
      "rmse_dy": 0.007153947371989489,
      "rmse_mean": 0.014060872606933117,
      "rotation_flip": 0.005567928776144981,
      "sparse_tokens": 32089.0,
      "step": 28,
      "turn_loss": 0.11396036297082901,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.0013473332094406244,
      "grad_norm": 0.41098248958587646,
      "learning_rate": 2.3333333333333336e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.051686979830265045,
      "mae_dx": 0.022249221801757812,
      "mae_dy": 0.005073432810604572,
      "pose_mae_dtheta": 0.4528733193874359,
      "pose_mae_dx": 0.21088460087776184,
      "pose_mae_dy": 0.07152487337589264,
      "pose_rmse_dtheta": 0.6897743344306946,
      "pose_rmse_dx": 0.3670814037322998,
      "pose_rmse_dy": 0.16058951616287231,
      "pose_rmse_mean": 0.405815064907074,
      "rmse_dtheta": 0.06963551789522171,
      "rmse_dx": 0.035693541169166565,
      "rmse_dy": 0.010873613879084587,
      "rmse_mean": 0.038734227418899536,
      "rotation_flip": 0.012413793243467808,
      "sparse_tokens": 12243.0,
      "step": 29,
      "turn_loss": 0.3999929130077362,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.0013937929752834046,
      "grad_norm": 0.6094735860824585,
      "learning_rate": 2.4166666666666667e-06,
      "loss": 0.2432,
      "mae_dtheta": 0.06231047958135605,
      "mae_dx": 0.027561943978071213,
      "mae_dy": 0.007993252947926521,
      "pose_mae_dtheta": 0.5657668113708496,
      "pose_mae_dx": 0.26115649938583374,
      "pose_mae_dy": 0.09189990162849426,
      "pose_rmse_dtheta": 0.7857134342193604,
      "pose_rmse_dx": 0.43469804525375366,
      "pose_rmse_dy": 0.20608651638031006,
      "pose_rmse_mean": 0.47549936175346375,
      "rmse_dtheta": 0.07755580544471741,
      "rmse_dx": 0.0409613773226738,
      "rmse_dy": 0.01643632911145687,
      "rmse_mean": 0.04498450458049774,
      "rotation_flip": 0.022030651569366455,
      "sparse_tokens": 19298.0,
      "step": 30,
      "turn_loss": 0.5116613507270813,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.0014402527411261847,
      "grad_norm": 0.47790318727493286,
      "learning_rate": 2.5e-06,
      "loss": 0.1271,
      "mae_dtheta": 0.030242078006267548,
      "mae_dx": 0.012951971031725407,
      "mae_dy": 0.006604614667594433,
      "pose_mae_dtheta": 0.21508239209651947,
      "pose_mae_dx": 0.09802675247192383,
      "pose_mae_dy": 0.08417665958404541,
      "pose_rmse_dtheta": 0.385624498128891,
      "pose_rmse_dx": 0.20622092485427856,
      "pose_rmse_dy": 0.18760190904140472,
      "pose_rmse_mean": 0.2598157823085785,
      "rmse_dtheta": 0.0464763417840004,
      "rmse_dx": 0.02607446350157261,
      "rmse_dy": 0.012479913420975208,
      "rmse_mean": 0.028343573212623596,
      "rotation_flip": 0.01731025241315365,
      "sparse_tokens": 12593.0,
      "step": 31,
      "turn_loss": 0.2455325424671173,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.001486712506968965,
      "grad_norm": 0.4393313229084015,
      "learning_rate": 2.5833333333333337e-06,
      "loss": 0.112,
      "mae_dtheta": 0.03191694617271423,
      "mae_dx": 0.010248553939163685,
      "mae_dy": 0.003133864374831319,
      "pose_mae_dtheta": 0.23553192615509033,
      "pose_mae_dx": 0.06042683869600296,
      "pose_mae_dy": 0.04156668111681938,
      "pose_rmse_dtheta": 0.4308663308620453,
      "pose_rmse_dx": 0.1766807585954666,
      "pose_rmse_dy": 0.11881700158119202,
      "pose_rmse_mean": 0.2421213835477829,
      "rmse_dtheta": 0.050689131021499634,
      "rmse_dx": 0.02255471795797348,
      "rmse_dy": 0.007703316863626242,
      "rmse_mean": 0.026982389390468597,
      "rotation_flip": 0.008196720853447914,
      "sparse_tokens": 8118.0,
      "step": 32,
      "turn_loss": 0.22638405859470367,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.001533172272811745,
      "grad_norm": 0.611470639705658,
      "learning_rate": 2.666666666666667e-06,
      "loss": 0.1804,
      "mae_dtheta": 0.023557474836707115,
      "mae_dx": 0.008287179283797741,
      "mae_dy": 0.006731254048645496,
      "pose_mae_dtheta": 0.15448930859565735,
      "pose_mae_dx": 0.07332451641559601,
      "pose_mae_dy": 0.06602857261896133,
      "pose_rmse_dtheta": 0.27470862865448,
      "pose_rmse_dx": 0.18326303362846375,
      "pose_rmse_dy": 0.12670348584651947,
      "pose_rmse_mean": 0.19489172101020813,
      "rmse_dtheta": 0.042151033878326416,
      "rmse_dx": 0.018220864236354828,
      "rmse_dy": 0.013367045670747757,
      "rmse_mean": 0.024579649791121483,
      "rotation_flip": 0.010273972526192665,
      "sparse_tokens": 5290.0,
      "step": 33,
      "turn_loss": 0.33797749876976013,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.0015796320386545252,
      "grad_norm": 0.48515817523002625,
      "learning_rate": 2.7500000000000004e-06,
      "loss": 0.1278,
      "mae_dtheta": 0.025327064096927643,
      "mae_dx": 0.011821126565337181,
      "mae_dy": 0.005988362245261669,
      "pose_mae_dtheta": 0.20580890774726868,
      "pose_mae_dx": 0.10717232525348663,
      "pose_mae_dy": 0.08628679811954498,
      "pose_rmse_dtheta": 0.31973427534103394,
      "pose_rmse_dx": 0.22105759382247925,
      "pose_rmse_dy": 0.16539745032787323,
      "pose_rmse_mean": 0.23539644479751587,
      "rmse_dtheta": 0.03782777860760689,
      "rmse_dx": 0.023681191727519035,
      "rmse_dy": 0.01043429970741272,
      "rmse_mean": 0.023981090635061264,
      "rotation_flip": 0.015662651509046555,
      "sparse_tokens": 17943.0,
      "step": 34,
      "turn_loss": 0.2637866139411926,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.0016260918044973052,
      "grad_norm": 0.4681614637374878,
      "learning_rate": 2.8333333333333335e-06,
      "loss": 0.1344,
      "mae_dtheta": 0.01353403925895691,
      "mae_dx": 0.002281215274706483,
      "mae_dy": 0.0032967703882604837,
      "pose_mae_dtheta": 0.09520462155342102,
      "pose_mae_dx": 0.02951541170477867,
      "pose_mae_dy": 0.03983836993575096,
      "pose_rmse_dtheta": 0.2067883163690567,
      "pose_rmse_dx": 0.07195448875427246,
      "pose_rmse_dy": 0.09822146594524384,
      "pose_rmse_mean": 0.12565475702285767,
      "rmse_dtheta": 0.02630465477705002,
      "rmse_dx": 0.006207599304616451,
      "rmse_dy": 0.007518130354583263,
      "rmse_mean": 0.013343462720513344,
      "rotation_flip": 0.0037491479888558388,
      "sparse_tokens": 32153.0,
      "step": 35,
      "turn_loss": 0.11351585388183594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.0016725515703400855,
      "grad_norm": 0.3511835038661957,
      "learning_rate": 2.916666666666667e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.011109650135040283,
      "mae_dx": 0.0025454850401729345,
      "mae_dy": 0.0018897460540756583,
      "pose_mae_dtheta": 0.07763635367155075,
      "pose_mae_dx": 0.026157965883612633,
      "pose_mae_dy": 0.027940519154071808,
      "pose_rmse_dtheta": 0.1812232881784439,
      "pose_rmse_dx": 0.08076053112745285,
      "pose_rmse_dy": 0.06623215973377228,
      "pose_rmse_mean": 0.10940532386302948,
      "rmse_dtheta": 0.023260153830051422,
      "rmse_dx": 0.008841728791594505,
      "rmse_dy": 0.004612455144524574,
      "rmse_mean": 0.012238113209605217,
      "rotation_flip": 0.004732607863843441,
      "sparse_tokens": 32073.0,
      "step": 36,
      "turn_loss": 0.08072975277900696,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30170.0,
      "epoch": 0.0017190113361828657,
      "grad_norm": 0.336476594209671,
      "learning_rate": 3e-06,
      "loss": 0.1167,
      "mae_dtheta": 0.03688555210828781,
      "mae_dx": 0.012074248865246773,
      "mae_dy": 0.006640169769525528,
      "pose_mae_dtheta": 0.2748391926288605,
      "pose_mae_dx": 0.09059914946556091,
      "pose_mae_dy": 0.09078037738800049,
      "pose_rmse_dtheta": 0.4764788746833801,
      "pose_rmse_dx": 0.21350862085819244,
      "pose_rmse_dy": 0.2157418131828308,
      "pose_rmse_mean": 0.30190977454185486,
      "rmse_dtheta": 0.054542426019907,
      "rmse_dx": 0.02513273060321808,
      "rmse_dy": 0.013545306399464607,
      "rmse_mean": 0.03107348643243313,
      "rotation_flip": 0.014524328522384167,
      "sparse_tokens": 25345.0,
      "step": 37,
      "turn_loss": 0.27821069955825806,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0017654711020256458,
      "grad_norm": 0.49987587332725525,
      "learning_rate": 3.0833333333333336e-06,
      "loss": 0.1892,
      "mae_dtheta": 0.01291000097990036,
      "mae_dx": 0.00294553954154253,
      "mae_dy": 0.004359267186373472,
      "pose_mae_dtheta": 0.09684261679649353,
      "pose_mae_dx": 0.03675003722310066,
      "pose_mae_dy": 0.050755880773067474,
      "pose_rmse_dtheta": 0.20633216202259064,
      "pose_rmse_dx": 0.0949968546628952,
      "pose_rmse_dy": 0.13397155702114105,
      "pose_rmse_mean": 0.1451002061367035,
      "rmse_dtheta": 0.024035129696130753,
      "rmse_dx": 0.008088515140116215,
      "rmse_dy": 0.010514838621020317,
      "rmse_mean": 0.014212827198207378,
      "rotation_flip": 0.0014383315574377775,
      "sparse_tokens": 32121.0,
      "step": 38,
      "turn_loss": 0.12286149710416794,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.001811930867868426,
      "grad_norm": 0.4648394286632538,
      "learning_rate": 3.1666666666666667e-06,
      "loss": 0.1553,
      "mae_dtheta": 0.03501518815755844,
      "mae_dx": 0.011224312707781792,
      "mae_dy": 0.005728097632527351,
      "pose_mae_dtheta": 0.28126421570777893,
      "pose_mae_dx": 0.09286553412675858,
      "pose_mae_dy": 0.06653254479169846,
      "pose_rmse_dtheta": 0.48624998331069946,
      "pose_rmse_dx": 0.21388113498687744,
      "pose_rmse_dy": 0.14878429472446442,
      "pose_rmse_mean": 0.2829717993736267,
      "rmse_dtheta": 0.05262669548392296,
      "rmse_dx": 0.023329826071858406,
      "rmse_dy": 0.011172912083566189,
      "rmse_mean": 0.02904314547777176,
      "rotation_flip": 0.013991769403219223,
      "sparse_tokens": 18508.0,
      "step": 39,
      "turn_loss": 0.27188652753829956,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.001858390633711206,
      "grad_norm": 0.5864601135253906,
      "learning_rate": 3.2500000000000002e-06,
      "loss": 0.0837,
      "mae_dtheta": 0.007595533039420843,
      "mae_dx": 0.0033705115783959627,
      "mae_dy": 0.0030100070871412754,
      "pose_mae_dtheta": 0.05674163997173309,
      "pose_mae_dx": 0.033326391130685806,
      "pose_mae_dy": 0.02822996862232685,
      "pose_rmse_dtheta": 0.1421131044626236,
      "pose_rmse_dx": 0.10472431778907776,
      "pose_rmse_dy": 0.07516412436962128,
      "pose_rmse_mean": 0.10733385384082794,
      "rmse_dtheta": 0.01855809986591339,
      "rmse_dx": 0.010560340248048306,
      "rmse_dy": 0.008700195699930191,
      "rmse_mean": 0.012606212869286537,
      "rotation_flip": 0.003924133256077766,
      "sparse_tokens": 32057.0,
      "step": 40,
      "turn_loss": 0.07978808134794235,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.0019048503995539863,
      "grad_norm": 0.41373854875564575,
      "learning_rate": 3.3333333333333333e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.008967257104814053,
      "mae_dx": 0.0015643048100173473,
      "mae_dy": 0.0018721177475526929,
      "pose_mae_dtheta": 0.06466495245695114,
      "pose_mae_dx": 0.01714189350605011,
      "pose_mae_dy": 0.024333538487553596,
      "pose_rmse_dtheta": 0.19528339803218842,
      "pose_rmse_dx": 0.04716910794377327,
      "pose_rmse_dy": 0.0646173283457756,
      "pose_rmse_mean": 0.10235661268234253,
      "rmse_dtheta": 0.02367057278752327,
      "rmse_dx": 0.004781813360750675,
      "rmse_dy": 0.004880881868302822,
      "rmse_mean": 0.011111089959740639,
      "rotation_flip": 0.0014992504147812724,
      "sparse_tokens": 32105.0,
      "step": 41,
      "turn_loss": 0.07978228479623795,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.0019513101653967663,
      "grad_norm": 0.5492740869522095,
      "learning_rate": 3.416666666666667e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.013074561022222042,
      "mae_dx": 0.0025384107138961554,
      "mae_dy": 0.002083385130390525,
      "pose_mae_dtheta": 0.09797820448875427,
      "pose_mae_dx": 0.02947041764855385,
      "pose_mae_dy": 0.032618071883916855,
      "pose_rmse_dtheta": 0.23906810581684113,
      "pose_rmse_dx": 0.09009341150522232,
      "pose_rmse_dy": 0.09210188686847687,
      "pose_rmse_mean": 0.14042113721370697,
      "rmse_dtheta": 0.028497682884335518,
      "rmse_dx": 0.008397683501243591,
      "rmse_dy": 0.005229441449046135,
      "rmse_mean": 0.014041602611541748,
      "rotation_flip": 0.0013210040051490068,
      "sparse_tokens": 32105.0,
      "step": 42,
      "turn_loss": 0.08296407014131546,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.0019977699312395463,
      "grad_norm": 0.6161952018737793,
      "learning_rate": 3.5e-06,
      "loss": 0.1634,
      "mae_dtheta": 0.06331996619701385,
      "mae_dx": 0.019548803567886353,
      "mae_dy": 0.008801016956567764,
      "pose_mae_dtheta": 0.5995868444442749,
      "pose_mae_dx": 0.16401295363903046,
      "pose_mae_dy": 0.11046699434518814,
      "pose_rmse_dtheta": 0.8624547123908997,
      "pose_rmse_dx": 0.28732261061668396,
      "pose_rmse_dy": 0.22071179747581482,
      "pose_rmse_mean": 0.4568297266960144,
      "rmse_dtheta": 0.08120495826005936,
      "rmse_dx": 0.03248635306954384,
      "rmse_dy": 0.015658985823392868,
      "rmse_mean": 0.043116770684719086,
      "rotation_flip": 0.022889843210577965,
      "sparse_tokens": 12348.0,
      "step": 43,
      "turn_loss": 0.43893176317214966,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0020442296970823266,
      "grad_norm": 0.4212909936904907,
      "learning_rate": 3.5833333333333335e-06,
      "loss": 0.0847,
      "mae_dtheta": 0.009745188988745213,
      "mae_dx": 0.0018773158080875874,
      "mae_dy": 0.0018622674979269505,
      "pose_mae_dtheta": 0.07080236077308655,
      "pose_mae_dx": 0.02272137999534607,
      "pose_mae_dy": 0.02664071135222912,
      "pose_rmse_dtheta": 0.18006782233715057,
      "pose_rmse_dx": 0.059600360691547394,
      "pose_rmse_dy": 0.0690549686551094,
      "pose_rmse_mean": 0.10290771722793579,
      "rmse_dtheta": 0.023700226098299026,
      "rmse_dx": 0.005974971689283848,
      "rmse_dy": 0.004541193600744009,
      "rmse_mean": 0.011405463330447674,
      "rotation_flip": 0.0024015370290726423,
      "sparse_tokens": 32089.0,
      "step": 44,
      "turn_loss": 0.07138430327177048,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.002090689462925107,
      "grad_norm": 0.38885006308555603,
      "learning_rate": 3.6666666666666666e-06,
      "loss": 0.095,
      "mae_dtheta": 0.012625524774193764,
      "mae_dx": 0.002502506598830223,
      "mae_dy": 0.0032029312569648027,
      "pose_mae_dtheta": 0.09071968495845795,
      "pose_mae_dx": 0.028717752546072006,
      "pose_mae_dy": 0.036211442202329636,
      "pose_rmse_dtheta": 0.19020341336727142,
      "pose_rmse_dx": 0.06809983402490616,
      "pose_rmse_dy": 0.08115246891975403,
      "pose_rmse_mean": 0.1131519079208374,
      "rmse_dtheta": 0.024260809645056725,
      "rmse_dx": 0.007289229892194271,
      "rmse_dy": 0.007241165265440941,
      "rmse_mean": 0.012930400669574738,
      "rotation_flip": 0.005263158120214939,
      "sparse_tokens": 32137.0,
      "step": 45,
      "turn_loss": 0.1196822077035904,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.002137149228767887,
      "grad_norm": 0.5564692616462708,
      "learning_rate": 3.7500000000000005e-06,
      "loss": 0.1223,
      "mae_dtheta": 0.00980570912361145,
      "mae_dx": 0.0019169977167621255,
      "mae_dy": 0.0020041808020323515,
      "pose_mae_dtheta": 0.07164987176656723,
      "pose_mae_dx": 0.02259943261742592,
      "pose_mae_dy": 0.027379300445318222,
      "pose_rmse_dtheta": 0.2096230387687683,
      "pose_rmse_dx": 0.06081364303827286,
      "pose_rmse_dy": 0.07406746596097946,
      "pose_rmse_mean": 0.11483471840620041,
      "rmse_dtheta": 0.0236391332000494,
      "rmse_dx": 0.0058019161224365234,
      "rmse_dy": 0.004500380717217922,
      "rmse_mean": 0.011313810013234615,
      "rotation_flip": 0.0036706868559122086,
      "sparse_tokens": 32073.0,
      "step": 46,
      "turn_loss": 0.081264927983284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0021836089946106673,
      "grad_norm": 0.4216918647289276,
      "learning_rate": 3.833333333333334e-06,
      "loss": 0.1754,
      "mae_dtheta": 0.01302499882876873,
      "mae_dx": 0.001791314105503261,
      "mae_dy": 0.00298576382920146,
      "pose_mae_dtheta": 0.0958598181605339,
      "pose_mae_dx": 0.027569381520152092,
      "pose_mae_dy": 0.039485298097133636,
      "pose_rmse_dtheta": 0.20140580832958221,
      "pose_rmse_dx": 0.06243346631526947,
      "pose_rmse_dy": 0.08054644614458084,
      "pose_rmse_mean": 0.11479523777961731,
      "rmse_dtheta": 0.024233367294073105,
      "rmse_dx": 0.0053800237365067005,
      "rmse_dy": 0.005749031435698271,
      "rmse_mean": 0.011787474155426025,
      "rotation_flip": 0.006633499171584845,
      "sparse_tokens": 32089.0,
      "step": 47,
      "turn_loss": 0.10117693990468979,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.002230068760453447,
      "grad_norm": 0.48510292172431946,
      "learning_rate": 3.916666666666667e-06,
      "loss": 0.122,
      "mae_dtheta": 0.028080716729164124,
      "mae_dx": 0.00946580246090889,
      "mae_dy": 0.006172666326165199,
      "pose_mae_dtheta": 0.2085750550031662,
      "pose_mae_dx": 0.0707847848534584,
      "pose_mae_dy": 0.06566521525382996,
      "pose_rmse_dtheta": 0.3929067850112915,
      "pose_rmse_dx": 0.14198245108127594,
      "pose_rmse_dy": 0.13297350704669952,
      "pose_rmse_mean": 0.2226209044456482,
      "rmse_dtheta": 0.04647465795278549,
      "rmse_dx": 0.019805094227194786,
      "rmse_dy": 0.011673747561872005,
      "rmse_mean": 0.025984501466155052,
      "rotation_flip": 0.0036630036775022745,
      "sparse_tokens": 4698.0,
      "step": 48,
      "turn_loss": 0.21998099982738495,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 20710.0,
      "epoch": 0.0022765285262962274,
      "grad_norm": 0.9848549365997314,
      "learning_rate": 4.000000000000001e-06,
      "loss": 0.3864,
      "mae_dtheta": 0.060061804950237274,
      "mae_dx": 0.019034553319215775,
      "mae_dy": 0.0037893950939178467,
      "pose_mae_dtheta": 0.5528904795646667,
      "pose_mae_dx": 0.17499661445617676,
      "pose_mae_dy": 0.04186154156923294,
      "pose_rmse_dtheta": 0.767852783203125,
      "pose_rmse_dx": 0.3221433758735657,
      "pose_rmse_dy": 0.09585430473089218,
      "pose_rmse_mean": 0.39528346061706543,
      "rmse_dtheta": 0.07708076387643814,
      "rmse_dx": 0.03228786215186119,
      "rmse_dy": 0.009105891920626163,
      "rmse_mean": 0.039491504430770874,
      "rotation_flip": 0.014583333395421505,
      "sparse_tokens": 17071.0,
      "step": 49,
      "turn_loss": 0.34974774718284607,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.0023229882921390077,
      "grad_norm": 0.41244450211524963,
      "learning_rate": 4.083333333333334e-06,
      "loss": 0.1147,
      "mae_dtheta": 0.0132222855463624,
      "mae_dx": 0.002404747763648629,
      "mae_dy": 0.0033365865238010883,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.41244441270828247,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 148.3735809326172,
      "model/head/act_norm_mean": 103.52088265467172,
      "model/head/act_norm_min": 59.55868148803711,
      "model/head/act_over_embed": 71.14051973806346,
      "model/head/grad_frac": 0.10220004618167877,
      "model/head/grad_norm": 0.042151838541030884,
      "model/head/grad_zero_frac": 0.00020241938182152808,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.68197601010101,
      "model/head/update_ratio": 0.0007394514977931976,
      "model/head/weight_delta": 0.3828374445438385,
      "model/head/weight_delta_rel": 0.0067161028273403645,
      "model/head/weight_norm": 57.00419616699219,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4087372422218323,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.40867291287892427,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4086112976074219,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28084385178648763,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12704038619995117,
      "model/modality_embedder.encoders.pose/grad_norm": 0.052397094666957855,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.517776137672811,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017119502881541848,
      "model/modality_embedder.encoders.pose/weight_delta": 0.09909890592098236,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.003237870056182146,
      "model/modality_embedder.encoders.pose/weight_norm": 30.60666847229004,
      "model/modality_embedder/grad_frac": 0.12704038619995117,
      "model/modality_embedder/grad_norm": 0.052397094666957855,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.517776137672811,
      "model/modality_embedder/update_ratio": 0.0017119502881541848,
      "model/modality_embedder/weight_delta": 0.09909890592098236,
      "model/modality_embedder/weight_delta_rel": 0.003237870056182146,
      "model/modality_embedder/weight_norm": 30.60666847229004,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.11109924316406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.603137025012025,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.919400215148926,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.533087377491123,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06671825051307678,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.027517570182681084,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010027438402175903,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.07196304947137833,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0026223768945783377,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.44227409362793,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 80.5582275390625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.703355479397146,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.312358856201172,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.289167799752033,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06617423892021179,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.027293195948004723,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009454250102862716,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.07124343514442444,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.002467928221449256,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.86870574951172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 82.46820831298828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.694033589866923,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.486780166625977,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.657180434288964,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06648161262273788,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02741996943950653,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009206673130393028,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.06468050181865692,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0021718500647693872,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.782712936401367,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.28362274169922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.653369007535673,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.983060836791992,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.00365407689812,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06585007160902023,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.027159493416547775,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0003026145859621465,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009281195816583931,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.05584629997611046,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0019085615640506148,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.262924194335938,
      "model/normalizer/grad_frac": 0.22866803407669067,
      "model/normalizer/grad_norm": 0.09431285411119461,
      "model/normalizer/grad_zero_frac": 0.00024225637025665492,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0012146716471761465,
      "model/normalizer/weight_delta": 0.13603878021240234,
      "model/normalizer/weight_delta_rel": 0.0017521007684990764,
      "model/normalizer/weight_norm": 77.64472961425781,
      "pose_mae_dtheta": 0.09489285945892334,
      "pose_mae_dx": 0.03177433833479881,
      "pose_mae_dy": 0.039647236466407776,
      "pose_rmse_dtheta": 0.22903139889240265,
      "pose_rmse_dx": 0.08283795416355133,
      "pose_rmse_dy": 0.09359889477491379,
      "pose_rmse_mean": 0.13515609502792358,
      "rmse_dtheta": 0.02748124673962593,
      "rmse_dx": 0.008104409091174603,
      "rmse_dy": 0.00778472563251853,
      "rmse_mean": 0.014456793665885925,
      "rotation_flip": 0.005382545292377472,
      "sparse_tokens": 32057.0,
      "step": 50,
      "turn_loss": 0.11365258693695068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.002369448057981788,
      "grad_norm": 0.43505874276161194,
      "learning_rate": 4.166666666666667e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.013433987274765968,
      "mae_dx": 0.001580684445798397,
      "mae_dy": 0.0022565440740436316,
      "pose_mae_dtheta": 0.08981239795684814,
      "pose_mae_dx": 0.025485925376415253,
      "pose_mae_dy": 0.03558540344238281,
      "pose_rmse_dtheta": 0.1942453384399414,
      "pose_rmse_dx": 0.06626402586698532,
      "pose_rmse_dy": 0.07830114662647247,
      "pose_rmse_mean": 0.1129368394613266,
      "rmse_dtheta": 0.025862479582428932,
      "rmse_dx": 0.005924666300415993,
      "rmse_dy": 0.003991913516074419,
      "rmse_mean": 0.011926352977752686,
      "rotation_flip": 0.002441576449200511,
      "sparse_tokens": 32057.0,
      "step": 51,
      "turn_loss": 0.09210582822561264,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.0024159078238245677,
      "grad_norm": 0.5035805702209473,
      "learning_rate": 4.25e-06,
      "loss": 0.1118,
      "mae_dtheta": 0.03951771929860115,
      "mae_dx": 0.023319365456700325,
      "mae_dy": 0.007050652988255024,
      "pose_mae_dtheta": 0.3207588195800781,
      "pose_mae_dx": 0.20365391671657562,
      "pose_mae_dy": 0.09563252329826355,
      "pose_rmse_dtheta": 0.5118767023086548,
      "pose_rmse_dx": 0.3712994158267975,
      "pose_rmse_dy": 0.19602070748806,
      "pose_rmse_mean": 0.3597322702407837,
      "rmse_dtheta": 0.05607611685991287,
      "rmse_dx": 0.03783741593360901,
      "rmse_dy": 0.012796345166862011,
      "rmse_mean": 0.03556995838880539,
      "rotation_flip": 0.01820020191371441,
      "sparse_tokens": 17813.0,
      "step": 52,
      "turn_loss": 0.34050631523132324,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.002462367589667348,
      "grad_norm": 0.9239137172698975,
      "learning_rate": 4.333333333333334e-06,
      "loss": 0.2644,
      "mae_dtheta": 0.02742835320532322,
      "mae_dx": 0.005926401820033789,
      "mae_dy": 0.006661666091531515,
      "pose_mae_dtheta": 0.18974676728248596,
      "pose_mae_dx": 0.06329842656850815,
      "pose_mae_dy": 0.059896573424339294,
      "pose_rmse_dtheta": 0.34083619713783264,
      "pose_rmse_dx": 0.15155568718910217,
      "pose_rmse_dy": 0.12391304969787598,
      "pose_rmse_mean": 0.20543497800827026,
      "rmse_dtheta": 0.04385089501738548,
      "rmse_dx": 0.015487068332731724,
      "rmse_dy": 0.012487618252635002,
      "rmse_mean": 0.02394185960292816,
      "rotation_flip": 0.015075377188622952,
      "sparse_tokens": 6544.0,
      "step": 53,
      "turn_loss": 0.32854047417640686,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.002508827355510128,
      "grad_norm": 0.5748826861381531,
      "learning_rate": 4.416666666666667e-06,
      "loss": 0.1704,
      "mae_dtheta": 0.014780514873564243,
      "mae_dx": 0.003184253117069602,
      "mae_dy": 0.0045107207261025906,
      "pose_mae_dtheta": 0.11071355640888214,
      "pose_mae_dx": 0.03807109221816063,
      "pose_mae_dy": 0.038056667894124985,
      "pose_rmse_dtheta": 0.28553053736686707,
      "pose_rmse_dx": 0.09200048446655273,
      "pose_rmse_dy": 0.09767460823059082,
      "pose_rmse_mean": 0.15840187668800354,
      "rmse_dtheta": 0.031136266887187958,
      "rmse_dx": 0.008077846840023994,
      "rmse_dy": 0.009851398877799511,
      "rmse_mean": 0.01635517179965973,
      "rotation_flip": 0.006601806730031967,
      "sparse_tokens": 32105.0,
      "step": 54,
      "turn_loss": 0.13503652811050415,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.0025552871213529085,
      "grad_norm": 0.5196324586868286,
      "learning_rate": 4.5e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.050576917827129364,
      "mae_dx": 0.0177130289375782,
      "mae_dy": 0.005064953584223986,
      "pose_mae_dtheta": 0.4740295708179474,
      "pose_mae_dx": 0.1540292352437973,
      "pose_mae_dy": 0.06906676292419434,
      "pose_rmse_dtheta": 0.6930867433547974,
      "pose_rmse_dx": 0.3063869774341583,
      "pose_rmse_dy": 0.1487005203962326,
      "pose_rmse_mean": 0.38272473216056824,
      "rmse_dtheta": 0.06757599115371704,
      "rmse_dx": 0.0310163926333189,
      "rmse_dy": 0.009122977964580059,
      "rmse_mean": 0.03590512275695801,
      "rotation_flip": 0.01600000075995922,
      "sparse_tokens": 10367.0,
      "step": 55,
      "turn_loss": 0.3762187361717224,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.0026017468871956887,
      "grad_norm": 0.5871118307113647,
      "learning_rate": 4.583333333333333e-06,
      "loss": 0.2169,
      "mae_dtheta": 0.05150558799505234,
      "mae_dx": 0.015152747742831707,
      "mae_dy": 0.0072737582959234715,
      "pose_mae_dtheta": 0.49408745765686035,
      "pose_mae_dx": 0.11612184345722198,
      "pose_mae_dy": 0.12006814777851105,
      "pose_rmse_dtheta": 0.7810128927230835,
      "pose_rmse_dx": 0.25632017850875854,
      "pose_rmse_dy": 0.23139353096485138,
      "pose_rmse_mean": 0.42290887236595154,
      "rmse_dtheta": 0.0724007859826088,
      "rmse_dx": 0.029154418036341667,
      "rmse_dy": 0.012876070104539394,
      "rmse_mean": 0.038143761456012726,
      "rotation_flip": 0.011952191591262817,
      "sparse_tokens": 4405.0,
      "step": 56,
      "turn_loss": 0.2786310315132141,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.0026482066530384685,
      "grad_norm": 0.6970845460891724,
      "learning_rate": 4.666666666666667e-06,
      "loss": 0.2909,
      "mae_dtheta": 0.03198165446519852,
      "mae_dx": 0.015292858704924583,
      "mae_dy": 0.009887139312922955,
      "pose_mae_dtheta": 0.2681066393852234,
      "pose_mae_dx": 0.16342580318450928,
      "pose_mae_dy": 0.15083540976047516,
      "pose_rmse_dtheta": 0.3927733600139618,
      "pose_rmse_dx": 0.3077468276023865,
      "pose_rmse_dy": 0.23625673353672028,
      "pose_rmse_mean": 0.3122589588165283,
      "rmse_dtheta": 0.04459868744015694,
      "rmse_dx": 0.028578467667102814,
      "rmse_dy": 0.014755196869373322,
      "rmse_mean": 0.029310785233974457,
      "rotation_flip": 0.02435530163347721,
      "sparse_tokens": 13493.0,
      "step": 57,
      "turn_loss": 0.344873309135437,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.0026946664188812488,
      "grad_norm": 0.6059173941612244,
      "learning_rate": 4.75e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.05938415974378586,
      "mae_dx": 0.009808414615690708,
      "mae_dy": 0.005166448652744293,
      "pose_mae_dtheta": 0.534752607345581,
      "pose_mae_dx": 0.06999338418245316,
      "pose_mae_dy": 0.04994150251150131,
      "pose_rmse_dtheta": 0.8799343705177307,
      "pose_rmse_dx": 0.13855698704719543,
      "pose_rmse_dy": 0.11760057508945465,
      "pose_rmse_mean": 0.37869733572006226,
      "rmse_dtheta": 0.08154699206352234,
      "rmse_dx": 0.019927585497498512,
      "rmse_dy": 0.010691067203879356,
      "rmse_mean": 0.037388548254966736,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 6042.0,
      "step": 58,
      "turn_loss": 0.28808510303497314,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.002741126184724029,
      "grad_norm": 0.5581257343292236,
      "learning_rate": 4.833333333333333e-06,
      "loss": 0.1299,
      "mae_dtheta": 0.01622513122856617,
      "mae_dx": 0.004002328962087631,
      "mae_dy": 0.0032410016283392906,
      "pose_mae_dtheta": 0.13237035274505615,
      "pose_mae_dx": 0.04376735910773277,
      "pose_mae_dy": 0.04433833435177803,
      "pose_rmse_dtheta": 0.30221447348594666,
      "pose_rmse_dx": 0.1300424188375473,
      "pose_rmse_dy": 0.10211827605962753,
      "pose_rmse_mean": 0.1781250536441803,
      "rmse_dtheta": 0.03262033313512802,
      "rmse_dx": 0.012666468508541584,
      "rmse_dy": 0.007072278298437595,
      "rmse_mean": 0.01745302602648735,
      "rotation_flip": 0.004283674526959658,
      "sparse_tokens": 32057.0,
      "step": 59,
      "turn_loss": 0.13337551057338715,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.0027875859505668093,
      "grad_norm": 0.5377820730209351,
      "learning_rate": 4.9166666666666665e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.03300657495856285,
      "mae_dx": 0.00821546372026205,
      "mae_dy": 0.00402136379852891,
      "pose_mae_dtheta": 0.2644694745540619,
      "pose_mae_dx": 0.05875648185610771,
      "pose_mae_dy": 0.041987981647253036,
      "pose_rmse_dtheta": 0.4751267731189728,
      "pose_rmse_dx": 0.1230631098151207,
      "pose_rmse_dy": 0.10730957984924316,
      "pose_rmse_mean": 0.2351664900779724,
      "rmse_dtheta": 0.05174454301595688,
      "rmse_dx": 0.017385631799697876,
      "rmse_dy": 0.010489839129149914,
      "rmse_mean": 0.026540003716945648,
      "rotation_flip": 0.01253132801502943,
      "sparse_tokens": 6930.0,
      "step": 60,
      "turn_loss": 0.21635372936725616,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 28877.0,
      "epoch": 0.002834045716409589,
      "grad_norm": 0.4928812086582184,
      "learning_rate": 5e-06,
      "loss": 0.1357,
      "mae_dtheta": 0.03527204692363739,
      "mae_dx": 0.013172185979783535,
      "mae_dy": 0.004870948847383261,
      "pose_mae_dtheta": 0.25925517082214355,
      "pose_mae_dx": 0.10498537868261337,
      "pose_mae_dy": 0.059958457946777344,
      "pose_rmse_dtheta": 0.4789939820766449,
      "pose_rmse_dx": 0.2403073012828827,
      "pose_rmse_dy": 0.12616588175296783,
      "pose_rmse_mean": 0.2818223834037781,
      "rmse_dtheta": 0.05410576984286308,
      "rmse_dx": 0.02643468976020813,
      "rmse_dy": 0.008571026846766472,
      "rmse_mean": 0.029703831300139427,
      "rotation_flip": 0.013119533658027649,
      "sparse_tokens": 23743.0,
      "step": 61,
      "turn_loss": 0.2755836546421051,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.0028805054822523693,
      "grad_norm": 0.3434893488883972,
      "learning_rate": 5.0833333333333335e-06,
      "loss": 0.1137,
      "mae_dtheta": 0.03351647034287453,
      "mae_dx": 0.00947666447609663,
      "mae_dy": 0.004886962473392487,
      "pose_mae_dtheta": 0.31507885456085205,
      "pose_mae_dx": 0.08589482307434082,
      "pose_mae_dy": 0.06875455379486084,
      "pose_rmse_dtheta": 0.5816382765769958,
      "pose_rmse_dx": 0.20628534257411957,
      "pose_rmse_dy": 0.14896665513515472,
      "pose_rmse_mean": 0.3122967779636383,
      "rmse_dtheta": 0.053751181811094284,
      "rmse_dx": 0.02184155024588108,
      "rmse_dy": 0.009665288962423801,
      "rmse_mean": 0.028419341892004013,
      "rotation_flip": 0.01577909290790558,
      "sparse_tokens": 11848.0,
      "step": 62,
      "turn_loss": 0.2304965704679489,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0029269652480951496,
      "grad_norm": 0.7717562317848206,
      "learning_rate": 5.1666666666666675e-06,
      "loss": 0.074,
      "mae_dtheta": 0.009153567254543304,
      "mae_dx": 0.001964675262570381,
      "mae_dy": 0.002326315501704812,
      "pose_mae_dtheta": 0.06390764564275742,
      "pose_mae_dx": 0.024307457730174065,
      "pose_mae_dy": 0.028936166316270828,
      "pose_rmse_dtheta": 0.13227050006389618,
      "pose_rmse_dx": 0.06287463754415512,
      "pose_rmse_dy": 0.06616577506065369,
      "pose_rmse_mean": 0.08710363507270813,
      "rmse_dtheta": 0.018428253009915352,
      "rmse_dx": 0.006522895768284798,
      "rmse_dy": 0.004977739416062832,
      "rmse_mean": 0.009976296685636044,
      "rotation_flip": 0.0028889805544167757,
      "sparse_tokens": 32089.0,
      "step": 63,
      "turn_loss": 0.08252397179603577,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.00297342501393793,
      "grad_norm": 0.6503283977508545,
      "learning_rate": 5.2500000000000006e-06,
      "loss": 0.1638,
      "mae_dtheta": 0.042889922857284546,
      "mae_dx": 0.01700236089527607,
      "mae_dy": 0.004255715757608414,
      "pose_mae_dtheta": 0.41177916526794434,
      "pose_mae_dx": 0.14336390793323517,
      "pose_mae_dy": 0.06040780246257782,
      "pose_rmse_dtheta": 0.6762497425079346,
      "pose_rmse_dx": 0.264170378446579,
      "pose_rmse_dy": 0.16562241315841675,
      "pose_rmse_mean": 0.3686808943748474,
      "rmse_dtheta": 0.06250511109828949,
      "rmse_dx": 0.02994440123438835,
      "rmse_dy": 0.009515797719359398,
      "rmse_mean": 0.03398843854665756,
      "rotation_flip": 0.0021321962121874094,
      "sparse_tokens": 7633.0,
      "step": 64,
      "turn_loss": 0.3381093442440033,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.00301988477978071,
      "grad_norm": 0.32034698128700256,
      "learning_rate": 5.333333333333334e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.012405444867908955,
      "mae_dx": 0.002889700699597597,
      "mae_dy": 0.0024521825835108757,
      "pose_mae_dtheta": 0.08973494172096252,
      "pose_mae_dx": 0.027274109423160553,
      "pose_mae_dy": 0.032305195927619934,
      "pose_rmse_dtheta": 0.2096417248249054,
      "pose_rmse_dx": 0.06460289657115936,
      "pose_rmse_dy": 0.06810495257377625,
      "pose_rmse_mean": 0.11411651968955994,
      "rmse_dtheta": 0.025042898952960968,
      "rmse_dx": 0.00793419312685728,
      "rmse_dy": 0.005321538541465998,
      "rmse_mean": 0.012766211293637753,
      "rotation_flip": 0.003355704713612795,
      "sparse_tokens": 32153.0,
      "step": 65,
      "turn_loss": 0.10738590359687805,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10700.0,
      "epoch": 0.00306634454562349,
      "grad_norm": 0.4752053916454315,
      "learning_rate": 5.416666666666667e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.04081586375832558,
      "mae_dx": 0.017074959352612495,
      "mae_dy": 0.00514208385720849,
      "pose_mae_dtheta": 0.3748835623264313,
      "pose_mae_dx": 0.14963041245937347,
      "pose_mae_dy": 0.07204905152320862,
      "pose_rmse_dtheta": 0.5993193984031677,
      "pose_rmse_dx": 0.2995520234107971,
      "pose_rmse_dy": 0.1431249976158142,
      "pose_rmse_mean": 0.3473321795463562,
      "rmse_dtheta": 0.05803072080016136,
      "rmse_dx": 0.029573239386081696,
      "rmse_dy": 0.009361546486616135,
      "rmse_mean": 0.03232183679938316,
      "rotation_flip": 0.01046025101095438,
      "sparse_tokens": 8827.0,
      "step": 66,
      "turn_loss": 0.3627535402774811,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.00311280431146627,
      "grad_norm": 1.3030307292938232,
      "learning_rate": 5.500000000000001e-06,
      "loss": 0.2416,
      "mae_dtheta": 0.01525294128805399,
      "mae_dx": 0.005050730425864458,
      "mae_dy": 0.006778222508728504,
      "pose_mae_dtheta": 0.12461364269256592,
      "pose_mae_dx": 0.05953344702720642,
      "pose_mae_dy": 0.051806896924972534,
      "pose_rmse_dtheta": 0.2507131099700928,
      "pose_rmse_dx": 0.14012479782104492,
      "pose_rmse_dy": 0.13008052110671997,
      "pose_rmse_mean": 0.1736394762992859,
      "rmse_dtheta": 0.028274109587073326,
      "rmse_dx": 0.010778011754155159,
      "rmse_dy": 0.013446014374494553,
      "rmse_mean": 0.017499379813671112,
      "rotation_flip": 0.00870406161993742,
      "sparse_tokens": 32153.0,
      "step": 67,
      "turn_loss": 0.18047887086868286,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0031592640773090504,
      "grad_norm": 0.8855760097503662,
      "learning_rate": 5.583333333333334e-06,
      "loss": 0.2269,
      "mae_dtheta": 0.007864606566727161,
      "mae_dx": 0.0015070528024807572,
      "mae_dy": 0.00132558005861938,
      "pose_mae_dtheta": 0.056261055171489716,
      "pose_mae_dx": 0.018757881596684456,
      "pose_mae_dy": 0.02171371318399906,
      "pose_rmse_dtheta": 0.15981611609458923,
      "pose_rmse_dx": 0.05175776407122612,
      "pose_rmse_dy": 0.058069925755262375,
      "pose_rmse_mean": 0.08988127112388611,
      "rmse_dtheta": 0.022193530574440956,
      "rmse_dx": 0.0049042487516999245,
      "rmse_dy": 0.003111079568043351,
      "rmse_mean": 0.010069619864225388,
      "rotation_flip": 0.002357100835070014,
      "sparse_tokens": 32089.0,
      "step": 68,
      "turn_loss": 0.061245642602443695,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.0032057238431518306,
      "grad_norm": 0.7257738709449768,
      "learning_rate": 5.666666666666667e-06,
      "loss": 0.1602,
      "mae_dtheta": 0.03400295600295067,
      "mae_dx": 0.00846798438578844,
      "mae_dy": 0.006827632896602154,
      "pose_mae_dtheta": 0.2952266335487366,
      "pose_mae_dx": 0.09967809915542603,
      "pose_mae_dy": 0.12603610754013062,
      "pose_rmse_dtheta": 0.489061564207077,
      "pose_rmse_dx": 0.23077723383903503,
      "pose_rmse_dy": 0.2045244723558426,
      "pose_rmse_mean": 0.30812108516693115,
      "rmse_dtheta": 0.04859837889671326,
      "rmse_dx": 0.021636929363012314,
      "rmse_dy": 0.010381476953625679,
      "rmse_mean": 0.026872262358665466,
      "rotation_flip": 0.018115941435098648,
      "sparse_tokens": 4484.0,
      "step": 69,
      "turn_loss": 0.2244049608707428,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0032521836089946105,
      "grad_norm": 0.46810445189476013,
      "learning_rate": 5.75e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.012301383540034294,
      "mae_dx": 0.002676725620403886,
      "mae_dy": 0.003043903736397624,
      "pose_mae_dtheta": 0.0832555815577507,
      "pose_mae_dx": 0.030165530741214752,
      "pose_mae_dy": 0.03623843938112259,
      "pose_rmse_dtheta": 0.20695756375789642,
      "pose_rmse_dx": 0.08798419684171677,
      "pose_rmse_dy": 0.09578149765729904,
      "pose_rmse_mean": 0.13024109601974487,
      "rmse_dtheta": 0.02663608081638813,
      "rmse_dx": 0.009997179731726646,
      "rmse_dy": 0.008027094416320324,
      "rmse_mean": 0.014886785298585892,
      "rotation_flip": 0.007042253389954567,
      "sparse_tokens": 32121.0,
      "step": 70,
      "turn_loss": 0.11147227138280869,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0032986433748373907,
      "grad_norm": 0.504752516746521,
      "learning_rate": 5.833333333333334e-06,
      "loss": 0.104,
      "mae_dtheta": 0.01219359040260315,
      "mae_dx": 0.002134108217433095,
      "mae_dy": 0.0022275017108768225,
      "pose_mae_dtheta": 0.0892457440495491,
      "pose_mae_dx": 0.025060711428523064,
      "pose_mae_dy": 0.029241153970360756,
      "pose_rmse_dtheta": 0.23591439425945282,
      "pose_rmse_dx": 0.06358173489570618,
      "pose_rmse_dy": 0.06711051613092422,
      "pose_rmse_mean": 0.12220221012830734,
      "rmse_dtheta": 0.026914991438388824,
      "rmse_dx": 0.006922888569533825,
      "rmse_dy": 0.004582604859024286,
      "rmse_mean": 0.012806829065084457,
      "rotation_flip": 0.004521477036178112,
      "sparse_tokens": 32121.0,
      "step": 71,
      "turn_loss": 0.0895092710852623,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.003345103140680171,
      "grad_norm": 0.8705151081085205,
      "learning_rate": 5.916666666666667e-06,
      "loss": 0.1896,
      "mae_dtheta": 0.0250394344329834,
      "mae_dx": 0.012402421794831753,
      "mae_dy": 0.0030335860792547464,
      "pose_mae_dtheta": 0.18407317996025085,
      "pose_mae_dx": 0.1039874255657196,
      "pose_mae_dy": 0.02955114282667637,
      "pose_rmse_dtheta": 0.35922330617904663,
      "pose_rmse_dx": 0.25695136189460754,
      "pose_rmse_dy": 0.06423769146203995,
      "pose_rmse_mean": 0.22680413722991943,
      "rmse_dtheta": 0.04339861124753952,
      "rmse_dx": 0.025544965639710426,
      "rmse_dy": 0.005862545687705278,
      "rmse_mean": 0.024935375899076462,
      "rotation_flip": 0.012706479988992214,
      "sparse_tokens": 14751.0,
      "step": 72,
      "turn_loss": 0.20483903586864471,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.003391562906522951,
      "grad_norm": 0.9245014190673828,
      "learning_rate": 6e-06,
      "loss": 0.1604,
      "mae_dtheta": 0.012613570317626,
      "mae_dx": 0.002899652346968651,
      "mae_dy": 0.0038586659356951714,
      "pose_mae_dtheta": 0.09305822849273682,
      "pose_mae_dx": 0.039938267320394516,
      "pose_mae_dy": 0.04166676104068756,
      "pose_rmse_dtheta": 0.21637672185897827,
      "pose_rmse_dx": 0.10968638211488724,
      "pose_rmse_dy": 0.10787949711084366,
      "pose_rmse_mean": 0.1446475386619568,
      "rmse_dtheta": 0.027060868218541145,
      "rmse_dx": 0.008222009055316448,
      "rmse_dy": 0.009697877801954746,
      "rmse_mean": 0.014993584714829922,
      "rotation_flip": 0.006928406655788422,
      "sparse_tokens": 32073.0,
      "step": 73,
      "turn_loss": 0.1141897663474083,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.0034380226723657314,
      "grad_norm": 0.6332283616065979,
      "learning_rate": 6.083333333333333e-06,
      "loss": 0.1541,
      "mae_dtheta": 0.010142041370272636,
      "mae_dx": 0.0018533985130488873,
      "mae_dy": 0.0004836280713789165,
      "pose_mae_dtheta": 0.07748814672231674,
      "pose_mae_dx": 0.014448199421167374,
      "pose_mae_dy": 0.0064646778628230095,
      "pose_rmse_dtheta": 0.3044990003108978,
      "pose_rmse_dx": 0.034617580473423004,
      "pose_rmse_dy": 0.010482622310519218,
      "pose_rmse_mean": 0.116533063352108,
      "rmse_dtheta": 0.03318861871957779,
      "rmse_dx": 0.005044335965067148,
      "rmse_dy": 0.0008261288166977465,
      "rmse_mean": 0.013019694946706295,
      "rotation_flip": 0.0005515719531103969,
      "sparse_tokens": 32249.0,
      "step": 74,
      "turn_loss": 0.0595887154340744,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.0034844824382085113,
      "grad_norm": 0.6272087097167969,
      "learning_rate": 6.166666666666667e-06,
      "loss": 0.1948,
      "mae_dtheta": 0.0401897095143795,
      "mae_dx": 0.008880699053406715,
      "mae_dy": 0.003408829914405942,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6272087097167969,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 134.672119140625,
      "model/head/act_norm_mean": 94.68372002963362,
      "model/head/act_norm_min": 61.85874938964844,
      "model/head/act_over_embed": 65.06753884731728,
      "model/head/grad_frac": 0.12184377759695053,
      "model/head/grad_norm": 0.07642147690057755,
      "model/head/grad_zero_frac": 0.00016529859567526728,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6786604256465517,
      "model/head/update_ratio": 0.0013405322097241879,
      "model/head/weight_delta": 0.65726238489151,
      "model/head/weight_delta_rel": 0.01153032947331667,
      "model/head/weight_norm": 57.0083122253418,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.40878167748451233,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4087407386909097,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.408695787191391,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2808904623194793,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09662476927042007,
      "model/modality_embedder.encoders.pose/grad_norm": 0.060603898018598557,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5237354343220338,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019800770096480846,
      "model/modality_embedder.encoders.pose/weight_delta": 0.16068577766418457,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.005250105168670416,
      "model/modality_embedder.encoders.pose/weight_norm": 30.606840133666992,
      "model/modality_embedder/grad_frac": 0.09662476927042007,
      "model/modality_embedder/grad_norm": 0.060603898018598557,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5237354343220338,
      "model/modality_embedder/update_ratio": 0.0019800770096480846,
      "model/modality_embedder/weight_delta": 0.16068577766418457,
      "model/modality_embedder/weight_delta_rel": 0.005250105168670416,
      "model/modality_embedder/weight_norm": 30.606840133666992,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 67.76341247558594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.76124623700055,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.063225746154785,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.954532146063897,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08007241040468216,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.050222113728523254,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018300020601600409,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.10107865184545517,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.003683367045596242,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.44374656677246,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 68.5407485961914,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.695633210180624,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.444164276123047,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.596651621901913,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08369637280702591,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05249509587883949,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018182314233854413,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.10094371438026428,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.003496769117191434,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.87151527404785,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 70.35010528564453,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.392136613984675,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.092411041259766,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.762504643911164,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09176623076200485,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05755658075213432,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001932348357513547,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.09382686764001846,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0031505306251347065,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.78582000732422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 70.35749053955078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.38956024220033,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.632789611816406,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.135152861395593,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08456694334745407,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05304112285375595,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001812408328987658,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.081650510430336,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.002790427068248391,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.265548706054688,
      "model/normalizer/grad_frac": 0.2750563323497772,
      "model/normalizer/grad_norm": 0.17251773178577423,
      "model/normalizer/grad_zero_frac": 0.00022571203589905053,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0022218001540750265,
      "model/normalizer/weight_delta": 0.19415584206581116,
      "model/normalizer/weight_delta_rel": 0.0025006148498505354,
      "model/normalizer/weight_norm": 77.6477279663086,
      "pose_mae_dtheta": 0.32958072423934937,
      "pose_mae_dx": 0.06810730695724487,
      "pose_mae_dy": 0.041172824800014496,
      "pose_rmse_dtheta": 0.5567560195922852,
      "pose_rmse_dx": 0.1868872493505478,
      "pose_rmse_dy": 0.09844845533370972,
      "pose_rmse_mean": 0.2806972563266754,
      "rmse_dtheta": 0.05922373756766319,
      "rmse_dx": 0.021284161135554314,
      "rmse_dy": 0.007012726739048958,
      "rmse_mean": 0.02917354181408882,
      "rotation_flip": 0.018292682245373726,
      "sparse_tokens": 14878.0,
      "step": 75,
      "turn_loss": 0.26200833916664124,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.0035309422040512915,
      "grad_norm": 0.5539484620094299,
      "learning_rate": 6.25e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.037814438343048096,
      "mae_dx": 0.008992504328489304,
      "mae_dy": 0.003686092095449567,
      "pose_mae_dtheta": 0.31054243445396423,
      "pose_mae_dx": 0.07164295017719269,
      "pose_mae_dy": 0.059642717242240906,
      "pose_rmse_dtheta": 0.541159987449646,
      "pose_rmse_dx": 0.16822923719882965,
      "pose_rmse_dy": 0.11667957156896591,
      "pose_rmse_mean": 0.275356262922287,
      "rmse_dtheta": 0.0550181083381176,
      "rmse_dx": 0.019777167588472366,
      "rmse_dy": 0.006880763452500105,
      "rmse_mean": 0.027225345373153687,
      "rotation_flip": 0.013661202043294907,
      "sparse_tokens": 6517.0,
      "step": 76,
      "turn_loss": 0.2537001073360443,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0035774019698940718,
      "grad_norm": 0.4355373680591583,
      "learning_rate": 6.333333333333333e-06,
      "loss": 0.0981,
      "mae_dtheta": 0.01058987993746996,
      "mae_dx": 0.0018956366693601012,
      "mae_dy": 0.002430408028885722,
      "pose_mae_dtheta": 0.07610016316175461,
      "pose_mae_dx": 0.022740857675671577,
      "pose_mae_dy": 0.031656790524721146,
      "pose_rmse_dtheta": 0.15885460376739502,
      "pose_rmse_dx": 0.05186336115002632,
      "pose_rmse_dy": 0.07223830372095108,
      "pose_rmse_mean": 0.09431876242160797,
      "rmse_dtheta": 0.020687339827418327,
      "rmse_dx": 0.0053553045727312565,
      "rmse_dy": 0.004550921265035868,
      "rmse_mean": 0.010197855532169342,
      "rotation_flip": 0.0033809165470302105,
      "sparse_tokens": 32121.0,
      "step": 77,
      "turn_loss": 0.09022624790668488,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.003623861735736852,
      "grad_norm": 0.4760822355747223,
      "learning_rate": 6.416666666666667e-06,
      "loss": 0.126,
      "mae_dtheta": 0.009583218023180962,
      "mae_dx": 0.003601259319111705,
      "mae_dy": 0.0010757389245554805,
      "pose_mae_dtheta": 0.066473089158535,
      "pose_mae_dx": 0.035282596945762634,
      "pose_mae_dy": 0.01760650984942913,
      "pose_rmse_dtheta": 0.21976841986179352,
      "pose_rmse_dx": 0.08290603756904602,
      "pose_rmse_dy": 0.056960396468639374,
      "pose_rmse_mean": 0.11987829208374023,
      "rmse_dtheta": 0.02893163077533245,
      "rmse_dx": 0.00985768623650074,
      "rmse_dy": 0.002706927014514804,
      "rmse_mean": 0.013832081109285355,
      "rotation_flip": 0.002605523681268096,
      "sparse_tokens": 32169.0,
      "step": 78,
      "turn_loss": 0.1358686238527298,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.003670321501579632,
      "grad_norm": 0.6099335551261902,
      "learning_rate": 6.5000000000000004e-06,
      "loss": 0.1004,
      "mae_dtheta": 0.015727117657661438,
      "mae_dx": 0.004508493468165398,
      "mae_dy": 0.004370049573481083,
      "pose_mae_dtheta": 0.11828085035085678,
      "pose_mae_dx": 0.043490152806043625,
      "pose_mae_dy": 0.04883021116256714,
      "pose_rmse_dtheta": 0.2941223084926605,
      "pose_rmse_dx": 0.09847576916217804,
      "pose_rmse_dy": 0.12213358283042908,
      "pose_rmse_mean": 0.17157721519470215,
      "rmse_dtheta": 0.03176112100481987,
      "rmse_dx": 0.012822959572076797,
      "rmse_dy": 0.012187537737190723,
      "rmse_mean": 0.018923873081803322,
      "rotation_flip": 0.008507347665727139,
      "sparse_tokens": 32089.0,
      "step": 79,
      "turn_loss": 0.17761142551898956,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.003716781267422412,
      "grad_norm": 0.5635281205177307,
      "learning_rate": 6.5833333333333335e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.03487986698746681,
      "mae_dx": 0.022934388369321823,
      "mae_dy": 0.005815453361719847,
      "pose_mae_dtheta": 0.28789302706718445,
      "pose_mae_dx": 0.2031630277633667,
      "pose_mae_dy": 0.07891874760389328,
      "pose_rmse_dtheta": 0.4487724006175995,
      "pose_rmse_dx": 0.35247185826301575,
      "pose_rmse_dy": 0.14423471689224243,
      "pose_rmse_mean": 0.3151596784591675,
      "rmse_dtheta": 0.047902852296829224,
      "rmse_dx": 0.03570360317826271,
      "rmse_dy": 0.00947654340416193,
      "rmse_mean": 0.031027665361762047,
      "rotation_flip": 0.010071942582726479,
      "sparse_tokens": 15910.0,
      "step": 80,
      "turn_loss": 0.37979260087013245,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.0037632410332651923,
      "grad_norm": 0.543874979019165,
      "learning_rate": 6.666666666666667e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.009447810240089893,
      "mae_dx": 0.002289282390847802,
      "mae_dy": 0.0021402575075626373,
      "pose_mae_dtheta": 0.07165422290563583,
      "pose_mae_dx": 0.029753969982266426,
      "pose_mae_dy": 0.02513956092298031,
      "pose_rmse_dtheta": 0.2032511681318283,
      "pose_rmse_dx": 0.09062538295984268,
      "pose_rmse_dy": 0.0672798678278923,
      "pose_rmse_mean": 0.12038548290729523,
      "rmse_dtheta": 0.024044813588261604,
      "rmse_dx": 0.007691229227930307,
      "rmse_dy": 0.005819135811179876,
      "rmse_mean": 0.012518392875790596,
      "rotation_flip": 0.004261363763362169,
      "sparse_tokens": 32105.0,
      "step": 81,
      "turn_loss": 0.08218628168106079,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24987.0,
      "epoch": 0.0038097007991079726,
      "grad_norm": 0.3827759921550751,
      "learning_rate": 6.750000000000001e-06,
      "loss": 0.1183,
      "mae_dtheta": 0.03263569995760918,
      "mae_dx": 0.010627033188939095,
      "mae_dy": 0.006139606237411499,
      "pose_mae_dtheta": 0.23883378505706787,
      "pose_mae_dx": 0.08706839382648468,
      "pose_mae_dy": 0.05685988813638687,
      "pose_rmse_dtheta": 0.4571668207645416,
      "pose_rmse_dx": 0.20486846566200256,
      "pose_rmse_dy": 0.14410251379013062,
      "pose_rmse_mean": 0.2687126100063324,
      "rmse_dtheta": 0.05128731206059456,
      "rmse_dx": 0.022432779893279076,
      "rmse_dy": 0.012896745465695858,
      "rmse_mean": 0.028872279450297356,
      "rotation_flip": 0.012378426268696785,
      "sparse_tokens": 19399.0,
      "step": 82,
      "turn_loss": 0.2906370162963867,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.003856160564950753,
      "grad_norm": 0.9608672857284546,
      "learning_rate": 6.833333333333334e-06,
      "loss": 0.3455,
      "mae_dtheta": 0.045017171651124954,
      "mae_dx": 0.015808314085006714,
      "mae_dy": 0.005427998956292868,
      "pose_mae_dtheta": 0.4045764207839966,
      "pose_mae_dx": 0.11442267149686813,
      "pose_mae_dy": 0.06883367896080017,
      "pose_rmse_dtheta": 0.6480868458747864,
      "pose_rmse_dx": 0.24535566568374634,
      "pose_rmse_dy": 0.15732738375663757,
      "pose_rmse_mean": 0.35025665163993835,
      "rmse_dtheta": 0.06358245015144348,
      "rmse_dx": 0.028920985758304596,
      "rmse_dy": 0.010439738631248474,
      "rmse_mean": 0.03431439399719238,
      "rotation_flip": 0.010045662522315979,
      "sparse_tokens": 20040.0,
      "step": 83,
      "turn_loss": 0.314697265625,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.0039026203307935326,
      "grad_norm": 0.49565520882606506,
      "learning_rate": 6.916666666666667e-06,
      "loss": 0.1054,
      "mae_dtheta": 0.011680975556373596,
      "mae_dx": 0.0026043469551950693,
      "mae_dy": 0.002562027657404542,
      "pose_mae_dtheta": 0.08455143123865128,
      "pose_mae_dx": 0.03138095140457153,
      "pose_mae_dy": 0.03539702668786049,
      "pose_rmse_dtheta": 0.18426215648651123,
      "pose_rmse_dx": 0.0832308679819107,
      "pose_rmse_dy": 0.07848738878965378,
      "pose_rmse_mean": 0.11532680690288544,
      "rmse_dtheta": 0.02306537888944149,
      "rmse_dx": 0.008636430837213993,
      "rmse_dy": 0.004952558316290379,
      "rmse_mean": 0.01221812330186367,
      "rotation_flip": 0.006722689140588045,
      "sparse_tokens": 32057.0,
      "step": 84,
      "turn_loss": 0.08457174152135849,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.003949080096636313,
      "grad_norm": 0.5293192267417908,
      "learning_rate": 7e-06,
      "loss": 0.1421,
      "mae_dtheta": 0.04681768640875816,
      "mae_dx": 0.009439648129045963,
      "mae_dy": 0.002699746750295162,
      "pose_mae_dtheta": 0.5091274976730347,
      "pose_mae_dx": 0.07479412108659744,
      "pose_mae_dy": 0.034049950540065765,
      "pose_rmse_dtheta": 0.751485288143158,
      "pose_rmse_dx": 0.17616179585456848,
      "pose_rmse_dy": 0.07394777983427048,
      "pose_rmse_mean": 0.3338649868965149,
      "rmse_dtheta": 0.0674198642373085,
      "rmse_dx": 0.019995613023638725,
      "rmse_dy": 0.005585193168371916,
      "rmse_mean": 0.031000224873423576,
      "rotation_flip": 0.03585657477378845,
      "sparse_tokens": 4258.0,
      "step": 85,
      "turn_loss": 0.2026538997888565,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.003995539862479093,
      "grad_norm": 0.5561493635177612,
      "learning_rate": 7.083333333333335e-06,
      "loss": 0.1024,
      "mae_dtheta": 0.0061437818221747875,
      "mae_dx": 0.0017712038243189454,
      "mae_dy": 0.000979902339167893,
      "pose_mae_dtheta": 0.04817694425582886,
      "pose_mae_dx": 0.01796264573931694,
      "pose_mae_dy": 0.016417328268289566,
      "pose_rmse_dtheta": 0.14949552714824677,
      "pose_rmse_dx": 0.04739966616034508,
      "pose_rmse_dy": 0.05397561937570572,
      "pose_rmse_mean": 0.08362361043691635,
      "rmse_dtheta": 0.018033962696790695,
      "rmse_dx": 0.005457741674035788,
      "rmse_dy": 0.0021656169556081295,
      "rmse_mean": 0.008552441373467445,
      "rotation_flip": 0.0031578948255628347,
      "sparse_tokens": 32137.0,
      "step": 86,
      "turn_loss": 0.04462266340851784,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.004041999628321873,
      "grad_norm": 0.6100399494171143,
      "learning_rate": 7.166666666666667e-06,
      "loss": 0.1637,
      "mae_dtheta": 0.028370210900902748,
      "mae_dx": 0.011022945865988731,
      "mae_dy": 0.002803872339427471,
      "pose_mae_dtheta": 0.22357439994812012,
      "pose_mae_dx": 0.08159225434064865,
      "pose_mae_dy": 0.01903255097568035,
      "pose_rmse_dtheta": 0.4072180390357971,
      "pose_rmse_dx": 0.18848226964473724,
      "pose_rmse_dy": 0.04228254035115242,
      "pose_rmse_mean": 0.21266095340251923,
      "rmse_dtheta": 0.04732297733426094,
      "rmse_dx": 0.023118048906326294,
      "rmse_dy": 0.007573993410915136,
      "rmse_mean": 0.026005005463957787,
      "rotation_flip": 0.010785824619233608,
      "sparse_tokens": 13253.0,
      "step": 87,
      "turn_loss": 0.19862061738967896,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.004088459394164653,
      "grad_norm": 0.6737438440322876,
      "learning_rate": 7.25e-06,
      "loss": 0.1462,
      "mae_dtheta": 0.015191856771707535,
      "mae_dx": 0.0026781782507896423,
      "mae_dy": 0.0038154416251927614,
      "pose_mae_dtheta": 0.10684715956449509,
      "pose_mae_dx": 0.03795241191983223,
      "pose_mae_dy": 0.049418527632951736,
      "pose_rmse_dtheta": 0.24783726036548615,
      "pose_rmse_dx": 0.10591593384742737,
      "pose_rmse_dy": 0.1274988055229187,
      "pose_rmse_mean": 0.1604173481464386,
      "rmse_dtheta": 0.029744882136583328,
      "rmse_dx": 0.00800570473074913,
      "rmse_dy": 0.008577609434723854,
      "rmse_mean": 0.01544273179024458,
      "rotation_flip": 0.006779660936444998,
      "sparse_tokens": 32073.0,
      "step": 88,
      "turn_loss": 0.11496935039758682,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.0041349191600074334,
      "grad_norm": 0.8245424032211304,
      "learning_rate": 7.333333333333333e-06,
      "loss": 0.1372,
      "mae_dtheta": 0.0514720156788826,
      "mae_dx": 0.014286826364696026,
      "mae_dy": 0.004711917135864496,
      "pose_mae_dtheta": 0.45458269119262695,
      "pose_mae_dx": 0.12040365487337112,
      "pose_mae_dy": 0.06226346269249916,
      "pose_rmse_dtheta": 0.7174156308174133,
      "pose_rmse_dx": 0.2557239234447479,
      "pose_rmse_dy": 0.159446120262146,
      "pose_rmse_mean": 0.3775285482406616,
      "rmse_dtheta": 0.0700862929224968,
      "rmse_dx": 0.02714274451136589,
      "rmse_dy": 0.009769195690751076,
      "rmse_mean": 0.035666078329086304,
      "rotation_flip": 0.019819820299744606,
      "sparse_tokens": 9783.0,
      "step": 89,
      "turn_loss": 0.32044655084609985,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.004181378925850214,
      "grad_norm": 0.5156534910202026,
      "learning_rate": 7.416666666666668e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.04220012202858925,
      "mae_dx": 0.014573647640645504,
      "mae_dy": 0.0073903645388782024,
      "pose_mae_dtheta": 0.3662792146205902,
      "pose_mae_dx": 0.1233421340584755,
      "pose_mae_dy": 0.09945300221443176,
      "pose_rmse_dtheta": 0.6125755310058594,
      "pose_rmse_dx": 0.2639099061489105,
      "pose_rmse_dy": 0.2164510041475296,
      "pose_rmse_mean": 0.36431217193603516,
      "rmse_dtheta": 0.06215536594390869,
      "rmse_dx": 0.027926050126552582,
      "rmse_dy": 0.01506023108959198,
      "rmse_mean": 0.03504721820354462,
      "rotation_flip": 0.013953488320112228,
      "sparse_tokens": 10855.0,
      "step": 90,
      "turn_loss": 0.3459683358669281,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.004227838691692994,
      "grad_norm": 0.4718005061149597,
      "learning_rate": 7.500000000000001e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.03730778396129608,
      "mae_dx": 0.017924848943948746,
      "mae_dy": 0.0054356809705495834,
      "pose_mae_dtheta": 0.34444472193717957,
      "pose_mae_dx": 0.14371827244758606,
      "pose_mae_dy": 0.08114401251077652,
      "pose_rmse_dtheta": 0.5563918352127075,
      "pose_rmse_dx": 0.27974632382392883,
      "pose_rmse_dy": 0.1762465536594391,
      "pose_rmse_mean": 0.33746156096458435,
      "rmse_dtheta": 0.05365936458110809,
      "rmse_dx": 0.031079430133104324,
      "rmse_dy": 0.009356741793453693,
      "rmse_mean": 0.031365178525447845,
      "rotation_flip": 0.0024844720028340816,
      "sparse_tokens": 13405.0,
      "step": 91,
      "turn_loss": 0.36042213439941406,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.004274298457535774,
      "grad_norm": 0.4782005846500397,
      "learning_rate": 7.583333333333333e-06,
      "loss": 0.1212,
      "mae_dtheta": 0.010487609542906284,
      "mae_dx": 0.0021823113784193993,
      "mae_dy": 0.0007057219045236707,
      "pose_mae_dtheta": 0.07531405240297318,
      "pose_mae_dx": 0.019482431933283806,
      "pose_mae_dy": 0.01352266501635313,
      "pose_rmse_dtheta": 0.21500074863433838,
      "pose_rmse_dx": 0.05013846978545189,
      "pose_rmse_dy": 0.04364308342337608,
      "pose_rmse_mean": 0.10292743891477585,
      "rmse_dtheta": 0.02750917337834835,
      "rmse_dx": 0.006701115518808365,
      "rmse_dy": 0.0017195496475324035,
      "rmse_mean": 0.011976612731814384,
      "rotation_flip": 0.001663893461227417,
      "sparse_tokens": 32137.0,
      "step": 92,
      "turn_loss": 0.0780230462551117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26931.0,
      "epoch": 0.004320758223378554,
      "grad_norm": 0.7640458941459656,
      "learning_rate": 7.666666666666667e-06,
      "loss": 0.1549,
      "mae_dtheta": 0.026618512347340584,
      "mae_dx": 0.010533791966736317,
      "mae_dy": 0.002861679531633854,
      "pose_mae_dtheta": 0.1828051060438156,
      "pose_mae_dx": 0.08732447773218155,
      "pose_mae_dy": 0.037510596215724945,
      "pose_rmse_dtheta": 0.35667601227760315,
      "pose_rmse_dx": 0.21498888731002808,
      "pose_rmse_dy": 0.08041463792324066,
      "pose_rmse_mean": 0.21735987067222595,
      "rmse_dtheta": 0.04443114995956421,
      "rmse_dx": 0.023385457694530487,
      "rmse_dy": 0.005603069439530373,
      "rmse_mean": 0.024473225697875023,
      "rotation_flip": 0.007897335104644299,
      "sparse_tokens": 20816.0,
      "step": 93,
      "turn_loss": 0.19823616743087769,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.004367217989221335,
      "grad_norm": 0.7331802845001221,
      "learning_rate": 7.75e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.011844220571219921,
      "mae_dx": 0.0022240118123590946,
      "mae_dy": 0.001369154779240489,
      "pose_mae_dtheta": 0.0933917984366417,
      "pose_mae_dx": 0.020301980897784233,
      "pose_mae_dy": 0.0175405852496624,
      "pose_rmse_dtheta": 0.30767127871513367,
      "pose_rmse_dx": 0.05356304347515106,
      "pose_rmse_dy": 0.043046317994594574,
      "pose_rmse_mean": 0.13476021587848663,
      "rmse_dtheta": 0.0330832377076149,
      "rmse_dx": 0.006934082601219416,
      "rmse_dy": 0.004374951124191284,
      "rmse_mean": 0.014797424897551537,
      "rotation_flip": 0.0021739129442721605,
      "sparse_tokens": 32137.0,
      "step": 94,
      "turn_loss": 0.0866318941116333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.004413677755064114,
      "grad_norm": 0.8264622688293457,
      "learning_rate": 7.833333333333333e-06,
      "loss": 0.2201,
      "mae_dtheta": 0.012135578319430351,
      "mae_dx": 0.0019181497627869248,
      "mae_dy": 0.0027711070142686367,
      "pose_mae_dtheta": 0.08510226011276245,
      "pose_mae_dx": 0.024570714682340622,
      "pose_mae_dy": 0.036401573568582535,
      "pose_rmse_dtheta": 0.15273916721343994,
      "pose_rmse_dx": 0.06145371124148369,
      "pose_rmse_dy": 0.07797089219093323,
      "pose_rmse_mean": 0.09738793224096298,
      "rmse_dtheta": 0.0206279456615448,
      "rmse_dx": 0.005977617111057043,
      "rmse_dy": 0.005293242167681456,
      "rmse_mean": 0.010632934980094433,
      "rotation_flip": 0.002659574383869767,
      "sparse_tokens": 32105.0,
      "step": 95,
      "turn_loss": 0.10543089359998703,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.004460137520906894,
      "grad_norm": 0.4951668679714203,
      "learning_rate": 7.916666666666667e-06,
      "loss": 0.1225,
      "mae_dtheta": 0.008708735927939415,
      "mae_dx": 0.0022011848632246256,
      "mae_dy": 0.0015811433549970388,
      "pose_mae_dtheta": 0.05833347141742706,
      "pose_mae_dx": 0.02449195459485054,
      "pose_mae_dy": 0.02393534779548645,
      "pose_rmse_dtheta": 0.14269393682479858,
      "pose_rmse_dx": 0.06866427510976791,
      "pose_rmse_dy": 0.05996816232800484,
      "pose_rmse_mean": 0.09044213593006134,
      "rmse_dtheta": 0.019743438810110092,
      "rmse_dx": 0.007347993087023497,
      "rmse_dy": 0.0034011222887784243,
      "rmse_mean": 0.010164185427129269,
      "rotation_flip": 0.002419842639937997,
      "sparse_tokens": 32041.0,
      "step": 96,
      "turn_loss": 0.08416472375392914,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.0045065972867496746,
      "grad_norm": 0.6748828291893005,
      "learning_rate": 8.000000000000001e-06,
      "loss": 0.1299,
      "mae_dtheta": 0.010596754029393196,
      "mae_dx": 0.002785106422379613,
      "mae_dy": 0.002586344024166465,
      "pose_mae_dtheta": 0.07198189944028854,
      "pose_mae_dx": 0.03015800192952156,
      "pose_mae_dy": 0.029201215133070946,
      "pose_rmse_dtheta": 0.1778775006532669,
      "pose_rmse_dx": 0.07521730661392212,
      "pose_rmse_dy": 0.0671280026435852,
      "pose_rmse_mean": 0.10674093663692474,
      "rmse_dtheta": 0.022124936804175377,
      "rmse_dx": 0.007935171015560627,
      "rmse_dy": 0.005810912698507309,
      "rmse_mean": 0.011957007460296154,
      "rotation_flip": 0.0048005906865000725,
      "sparse_tokens": 32153.0,
      "step": 97,
      "turn_loss": 0.1091100350022316,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.004553057052592455,
      "grad_norm": 0.738192617893219,
      "learning_rate": 8.083333333333334e-06,
      "loss": 0.1777,
      "mae_dtheta": 0.016171079128980637,
      "mae_dx": 0.0030114776454865932,
      "mae_dy": 0.0032004895620048046,
      "pose_mae_dtheta": 0.11065449565649033,
      "pose_mae_dx": 0.03657505288720131,
      "pose_mae_dy": 0.046248696744441986,
      "pose_rmse_dtheta": 0.23489224910736084,
      "pose_rmse_dx": 0.07747428864240646,
      "pose_rmse_dy": 0.10510079562664032,
      "pose_rmse_mean": 0.1391557902097702,
      "rmse_dtheta": 0.030377687886357307,
      "rmse_dx": 0.00829272624105215,
      "rmse_dy": 0.006027827505022287,
      "rmse_mean": 0.014899414032697678,
      "rotation_flip": 0.005788711830973625,
      "sparse_tokens": 32089.0,
      "step": 98,
      "turn_loss": 0.13858076930046082,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.004599516818435235,
      "grad_norm": 0.7164525985717773,
      "learning_rate": 8.166666666666668e-06,
      "loss": 0.2633,
      "mae_dtheta": 0.043655239045619965,
      "mae_dx": 0.010111483745276928,
      "mae_dy": 0.009952244348824024,
      "pose_mae_dtheta": 0.37122198939323425,
      "pose_mae_dx": 0.09719943255186081,
      "pose_mae_dy": 0.12379708141088486,
      "pose_rmse_dtheta": 0.5514483451843262,
      "pose_rmse_dx": 0.19317707419395447,
      "pose_rmse_dy": 0.22240330278873444,
      "pose_rmse_mean": 0.3223429322242737,
      "rmse_dtheta": 0.057167984545230865,
      "rmse_dx": 0.02056763879954815,
      "rmse_dy": 0.01613018661737442,
      "rmse_mean": 0.03128860518336296,
      "rotation_flip": 0.006884681526571512,
      "sparse_tokens": 10075.0,
      "step": 99,
      "turn_loss": 0.32947075366973877,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.004645976584278015,
      "grad_norm": 0.5955120921134949,
      "learning_rate": 8.25e-06,
      "loss": 0.0844,
      "mae_dtheta": 0.04323741793632507,
      "mae_dx": 0.01803206466138363,
      "mae_dy": 0.005540123209357262,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5955122709274292,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 113.83138275146484,
      "model/head/act_norm_mean": 87.72528076171875,
      "model/head/act_norm_min": 70.00315856933594,
      "model/head/act_over_embed": 60.28563423647136,
      "model/head/grad_frac": 0.10852708667516708,
      "model/head/grad_norm": 0.0646292120218277,
      "model/head/grad_zero_frac": 0.00012976415746379644,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6888427734375,
      "model/head/update_ratio": 0.0011335521703585982,
      "model/head/weight_delta": 0.8992524147033691,
      "model/head/weight_delta_rel": 0.01577555015683174,
      "model/head/weight_norm": 57.014766693115234,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.40876108407974243,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.40876108407974243,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.40876108407974243,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28090444386116165,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0828564465045929,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04934203252196312,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016120780492201447,
      "model/modality_embedder.encoders.pose/weight_delta": 0.23439013957977295,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.007658256217837334,
      "model/modality_embedder.encoders.pose/weight_norm": 30.60771942138672,
      "model/modality_embedder/grad_frac": 0.0828564465045929,
      "model/modality_embedder/grad_norm": 0.04934203252196312,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0016120780492201447,
      "model/modality_embedder/weight_delta": 0.23439013957977295,
      "model/modality_embedder/weight_delta_rel": 0.007658256217837334,
      "model/modality_embedder/weight_norm": 30.60771942138672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 58.8428955078125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.04811507936508,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.043649673461914,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.464461738097716,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09244480729103088,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0550520159304142,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 9.582795610185713e-05,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002005857415497303,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.12068771570920944,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.00439793337136507,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.445629119873047,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 60.54991912841797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.004803369915674,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.846355438232422,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.121906888020975,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09185107052326202,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.054698437452316284,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018942856695502996,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.12258059531450272,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.004246287513524294,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.87549591064453,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 62.5315055847168,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 23.70813182043651,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.404285430908203,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.292450146031094,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0995277687907219,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05927000939846039,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 9.0784378699027e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001989611191675067,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.11678745597600937,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.003921504132449627,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.789743423461914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 63.16690444946289,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 25.776159861731152,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.634278297424316,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 17.713618377192336,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12090519070625305,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07200052589178085,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 7.06100690877065e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0024600313045084476,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.10157828778028488,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.003471463918685913,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.26813507080078,
      "model/normalizer/grad_frac": 0.43014654517173767,
      "model/normalizer/grad_norm": 0.2561575472354889,
      "model/normalizer/grad_zero_frac": 9.690254955785349e-05,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0032988146413117647,
      "model/normalizer/weight_delta": 0.23782333731651306,
      "model/normalizer/weight_delta_rel": 0.0030630268156528473,
      "model/normalizer/weight_norm": 77.6513900756836,
      "pose_mae_dtheta": 0.3600253760814667,
      "pose_mae_dx": 0.16878952085971832,
      "pose_mae_dy": 0.06224675849080086,
      "pose_rmse_dtheta": 0.567089855670929,
      "pose_rmse_dx": 0.26665571331977844,
      "pose_rmse_dy": 0.11348875612020493,
      "pose_rmse_mean": 0.3157447874546051,
      "rmse_dtheta": 0.06281784921884537,
      "rmse_dx": 0.02879829704761505,
      "rmse_dy": 0.008978386409580708,
      "rmse_mean": 0.033531513065099716,
      "rotation_flip": 0.003937007859349251,
      "sparse_tokens": 4561.0,
      "step": 100,
      "turn_loss": 0.36466896533966064,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.0046924363501207956,
      "grad_norm": 0.5366764068603516,
      "learning_rate": 8.333333333333334e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.030944479629397392,
      "mae_dx": 0.008985781110823154,
      "mae_dy": 0.004716589581221342,
      "pose_mae_dtheta": 0.2322511523962021,
      "pose_mae_dx": 0.0679437443614006,
      "pose_mae_dy": 0.05933976545929909,
      "pose_rmse_dtheta": 0.43283331394195557,
      "pose_rmse_dx": 0.15399479866027832,
      "pose_rmse_dy": 0.15324893593788147,
      "pose_rmse_mean": 0.24669234454631805,
      "rmse_dtheta": 0.04909433424472809,
      "rmse_dx": 0.019793404266238213,
      "rmse_dy": 0.009225860238075256,
      "rmse_mean": 0.02603786811232567,
      "rotation_flip": 0.010309278033673763,
      "sparse_tokens": 21830.0,
      "step": 101,
      "turn_loss": 0.22852911055088043,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.004738896115963576,
      "grad_norm": 0.4648907780647278,
      "learning_rate": 8.416666666666667e-06,
      "loss": 0.1668,
      "mae_dtheta": 0.034450940787792206,
      "mae_dx": 0.012030537240207195,
      "mae_dy": 0.007083273958414793,
      "pose_mae_dtheta": 0.2944963276386261,
      "pose_mae_dx": 0.11494006961584091,
      "pose_mae_dy": 0.10701845586299896,
      "pose_rmse_dtheta": 0.49356067180633545,
      "pose_rmse_dx": 0.26259350776672363,
      "pose_rmse_dy": 0.2377202957868576,
      "pose_rmse_mean": 0.3312914967536926,
      "rmse_dtheta": 0.050046708434820175,
      "rmse_dx": 0.025394270196557045,
      "rmse_dy": 0.01429682970046997,
      "rmse_mean": 0.02991260401904583,
      "rotation_flip": 0.020388349890708923,
      "sparse_tokens": 21458.0,
      "step": 102,
      "turn_loss": 0.27995502948760986,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.004785355881806356,
      "grad_norm": 0.5725587606430054,
      "learning_rate": 8.5e-06,
      "loss": 0.133,
      "mae_dtheta": 0.04374111816287041,
      "mae_dx": 0.015177791006863117,
      "mae_dy": 0.0036761662922799587,
      "pose_mae_dtheta": 0.37126287817955017,
      "pose_mae_dx": 0.12427756190299988,
      "pose_mae_dy": 0.04099785536527634,
      "pose_rmse_dtheta": 0.5901966691017151,
      "pose_rmse_dx": 0.2739535868167877,
      "pose_rmse_dy": 0.11854609102010727,
      "pose_rmse_mean": 0.327565461397171,
      "rmse_dtheta": 0.06034103408455849,
      "rmse_dx": 0.029096338897943497,
      "rmse_dy": 0.009000055491924286,
      "rmse_mean": 0.03281247615814209,
      "rotation_flip": 0.017482517287135124,
      "sparse_tokens": 10176.0,
      "step": 103,
      "turn_loss": 0.289396733045578,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.004831815647649135,
      "grad_norm": 0.8073564171791077,
      "learning_rate": 8.583333333333333e-06,
      "loss": 0.215,
      "mae_dtheta": 0.029718799516558647,
      "mae_dx": 0.014666997827589512,
      "mae_dy": 0.0065935589373111725,
      "pose_mae_dtheta": 0.24316874146461487,
      "pose_mae_dx": 0.11530270427465439,
      "pose_mae_dy": 0.07925814390182495,
      "pose_rmse_dtheta": 0.4100937247276306,
      "pose_rmse_dx": 0.24993346631526947,
      "pose_rmse_dy": 0.17720834910869598,
      "pose_rmse_mean": 0.27907854318618774,
      "rmse_dtheta": 0.046062808483839035,
      "rmse_dx": 0.028546277433633804,
      "rmse_dy": 0.012951956130564213,
      "rmse_mean": 0.02918701432645321,
      "rotation_flip": 0.005836575757712126,
      "sparse_tokens": 8334.0,
      "step": 104,
      "turn_loss": 0.24167953431606293,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.004878275413491916,
      "grad_norm": 0.6887930035591125,
      "learning_rate": 8.666666666666668e-06,
      "loss": 0.1563,
      "mae_dtheta": 0.042484208941459656,
      "mae_dx": 0.01730511523783207,
      "mae_dy": 0.0064302049577236176,
      "pose_mae_dtheta": 0.38729146122932434,
      "pose_mae_dx": 0.12974703311920166,
      "pose_mae_dy": 0.08178158849477768,
      "pose_rmse_dtheta": 0.6460661888122559,
      "pose_rmse_dx": 0.2646961212158203,
      "pose_rmse_dy": 0.21269726753234863,
      "pose_rmse_mean": 0.3744865357875824,
      "rmse_dtheta": 0.06225978210568428,
      "rmse_dx": 0.029501937329769135,
      "rmse_dy": 0.015124419704079628,
      "rmse_mean": 0.03562871366739273,
      "rotation_flip": 0.007776049897074699,
      "sparse_tokens": 10756.0,
      "step": 105,
      "turn_loss": 0.33631631731987,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.004924735179334696,
      "grad_norm": 0.7135950922966003,
      "learning_rate": 8.750000000000001e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.014049109071493149,
      "mae_dx": 0.002291938755661249,
      "mae_dy": 0.0036214091815054417,
      "pose_mae_dtheta": 0.09747561812400818,
      "pose_mae_dx": 0.037975601851940155,
      "pose_mae_dy": 0.04277985170483589,
      "pose_rmse_dtheta": 0.2206173986196518,
      "pose_rmse_dx": 0.09666899591684341,
      "pose_rmse_dy": 0.09858023375272751,
      "pose_rmse_mean": 0.1386222243309021,
      "rmse_dtheta": 0.027534283697605133,
      "rmse_dx": 0.005698326043784618,
      "rmse_dy": 0.008073842152953148,
      "rmse_mean": 0.0137688172981143,
      "rotation_flip": 0.006518404930830002,
      "sparse_tokens": 32105.0,
      "step": 106,
      "turn_loss": 0.12211703509092331,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.004971194945177476,
      "grad_norm": 0.5268242955207825,
      "learning_rate": 8.833333333333334e-06,
      "loss": 0.116,
      "mae_dtheta": 0.009392794221639633,
      "mae_dx": 0.0025158654898405075,
      "mae_dy": 0.0018110822420567274,
      "pose_mae_dtheta": 0.07091514766216278,
      "pose_mae_dx": 0.02247525192797184,
      "pose_mae_dy": 0.026639292016625404,
      "pose_rmse_dtheta": 0.23107196390628815,
      "pose_rmse_dx": 0.06343569606542587,
      "pose_rmse_dy": 0.10604765266180038,
      "pose_rmse_mean": 0.13351844251155853,
      "rmse_dtheta": 0.025950197130441666,
      "rmse_dx": 0.007780878804624081,
      "rmse_dy": 0.005551980808377266,
      "rmse_mean": 0.01309435348957777,
      "rotation_flip": 0.004705882165580988,
      "sparse_tokens": 32089.0,
      "step": 107,
      "turn_loss": 0.10107878595590591,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.005017654711020256,
      "grad_norm": 0.4398179054260254,
      "learning_rate": 8.916666666666667e-06,
      "loss": 0.0946,
      "mae_dtheta": 0.010434652678668499,
      "mae_dx": 0.002073903800919652,
      "mae_dy": 0.0022377644199877977,
      "pose_mae_dtheta": 0.07809866964817047,
      "pose_mae_dx": 0.024497799575328827,
      "pose_mae_dy": 0.027698906138539314,
      "pose_rmse_dtheta": 0.2162197381258011,
      "pose_rmse_dx": 0.07726718485355377,
      "pose_rmse_dy": 0.06733427196741104,
      "pose_rmse_mean": 0.12027373164892197,
      "rmse_dtheta": 0.023831071332097054,
      "rmse_dx": 0.00695759104564786,
      "rmse_dy": 0.005503014661371708,
      "rmse_mean": 0.012097226455807686,
      "rotation_flip": 0.0046439627185463905,
      "sparse_tokens": 32057.0,
      "step": 108,
      "turn_loss": 0.08589611947536469,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.005064114476863037,
      "grad_norm": 0.5765412449836731,
      "learning_rate": 9e-06,
      "loss": 0.152,
      "mae_dtheta": 0.03349493071436882,
      "mae_dx": 0.011697761714458466,
      "mae_dy": 0.007219693157821894,
      "pose_mae_dtheta": 0.2515953481197357,
      "pose_mae_dx": 0.11470288783311844,
      "pose_mae_dy": 0.08050603419542313,
      "pose_rmse_dtheta": 0.44511914253234863,
      "pose_rmse_dx": 0.2337624579668045,
      "pose_rmse_dy": 0.15987318754196167,
      "pose_rmse_mean": 0.27958494424819946,
      "rmse_dtheta": 0.05005911365151405,
      "rmse_dx": 0.023412629961967468,
      "rmse_dy": 0.013042902573943138,
      "rmse_mean": 0.02883821539580822,
      "rotation_flip": 0.01560178305953741,
      "sparse_tokens": 22803.0,
      "step": 109,
      "turn_loss": 0.33982259035110474,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.005110574242705817,
      "grad_norm": 1.2037264108657837,
      "learning_rate": 9.083333333333333e-06,
      "loss": 0.3383,
      "mae_dtheta": 0.032661326229572296,
      "mae_dx": 0.023661861196160316,
      "mae_dy": 0.006150209344923496,
      "pose_mae_dtheta": 0.2489050030708313,
      "pose_mae_dx": 0.1974198818206787,
      "pose_mae_dy": 0.08993294835090637,
      "pose_rmse_dtheta": 0.41134387254714966,
      "pose_rmse_dx": 0.38053035736083984,
      "pose_rmse_dy": 0.1567208468914032,
      "pose_rmse_mean": 0.31619834899902344,
      "rmse_dtheta": 0.04668761044740677,
      "rmse_dx": 0.039325714111328125,
      "rmse_dy": 0.009810131974518299,
      "rmse_mean": 0.03194115310907364,
      "rotation_flip": 0.011363636702299118,
      "sparse_tokens": 5547.0,
      "step": 110,
      "turn_loss": 0.30106794834136963,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.005157034008548597,
      "grad_norm": 0.8698112964630127,
      "learning_rate": 9.166666666666666e-06,
      "loss": 0.1665,
      "mae_dtheta": 0.05496641620993614,
      "mae_dx": 0.01589800976216793,
      "mae_dy": 0.006505243480205536,
      "pose_mae_dtheta": 0.4874323308467865,
      "pose_mae_dx": 0.1311444640159607,
      "pose_mae_dy": 0.09304501116275787,
      "pose_rmse_dtheta": 0.7034406661987305,
      "pose_rmse_dx": 0.2515638470649719,
      "pose_rmse_dy": 0.19268102943897247,
      "pose_rmse_mean": 0.3825618624687195,
      "rmse_dtheta": 0.0701584741473198,
      "rmse_dx": 0.0289201270788908,
      "rmse_dy": 0.011126799508929253,
      "rmse_mean": 0.036735136061906815,
      "rotation_flip": 0.025510204955935478,
      "sparse_tokens": 10076.0,
      "step": 111,
      "turn_loss": 0.35376474261283875,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.005203493774391377,
      "grad_norm": 0.6674802899360657,
      "learning_rate": 9.250000000000001e-06,
      "loss": 0.1319,
      "mae_dtheta": 0.030729342252016068,
      "mae_dx": 0.011279015801846981,
      "mae_dy": 0.004188485909253359,
      "pose_mae_dtheta": 0.2392871230840683,
      "pose_mae_dx": 0.09475890547037125,
      "pose_mae_dy": 0.05142737552523613,
      "pose_rmse_dtheta": 0.44141584634780884,
      "pose_rmse_dx": 0.20949958264827728,
      "pose_rmse_dy": 0.13471192121505737,
      "pose_rmse_mean": 0.26187580823898315,
      "rmse_dtheta": 0.05110215023159981,
      "rmse_dx": 0.02281593531370163,
      "rmse_dy": 0.00905829668045044,
      "rmse_mean": 0.027658795937895775,
      "rotation_flip": 0.01092896144837141,
      "sparse_tokens": 9843.0,
      "step": 112,
      "turn_loss": 0.2423417568206787,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.005249953540234157,
      "grad_norm": 0.40401557087898254,
      "learning_rate": 9.333333333333334e-06,
      "loss": 0.0801,
      "mae_dtheta": 0.013284284621477127,
      "mae_dx": 0.002260544802993536,
      "mae_dy": 0.0029227223712950945,
      "pose_mae_dtheta": 0.09763907641172409,
      "pose_mae_dx": 0.028223346918821335,
      "pose_mae_dy": 0.04184524714946747,
      "pose_rmse_dtheta": 0.2205464392900467,
      "pose_rmse_dx": 0.07675091922283173,
      "pose_rmse_dy": 0.09115365892648697,
      "pose_rmse_mean": 0.1294836699962616,
      "rmse_dtheta": 0.025847837328910828,
      "rmse_dx": 0.007427067495882511,
      "rmse_dy": 0.006086357403546572,
      "rmse_mean": 0.013120420277118683,
      "rotation_flip": 0.006691449787467718,
      "sparse_tokens": 32089.0,
      "step": 113,
      "turn_loss": 0.09466111660003662,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.005296413306076937,
      "grad_norm": 0.5744092464447021,
      "learning_rate": 9.416666666666667e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.011430663987994194,
      "mae_dx": 0.001913845888338983,
      "mae_dy": 0.0023283243644982576,
      "pose_mae_dtheta": 0.08421765267848969,
      "pose_mae_dx": 0.027139579877257347,
      "pose_mae_dy": 0.03136937692761421,
      "pose_rmse_dtheta": 0.23384611308574677,
      "pose_rmse_dx": 0.06590763479471207,
      "pose_rmse_dy": 0.09130397439002991,
      "pose_rmse_mean": 0.13035258650779724,
      "rmse_dtheta": 0.026017779484391212,
      "rmse_dx": 0.005794767290353775,
      "rmse_dy": 0.0056584542617201805,
      "rmse_mean": 0.012490334920585155,
      "rotation_flip": 0.0047846888191998005,
      "sparse_tokens": 32073.0,
      "step": 114,
      "turn_loss": 0.08123178035020828,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.005342873071919717,
      "grad_norm": 0.8806053400039673,
      "learning_rate": 9.5e-06,
      "loss": 0.2589,
      "mae_dtheta": 0.0177896860986948,
      "mae_dx": 0.006567439530044794,
      "mae_dy": 0.0065625919960439205,
      "pose_mae_dtheta": 0.13500431180000305,
      "pose_mae_dx": 0.07266045361757278,
      "pose_mae_dy": 0.061490897089242935,
      "pose_rmse_dtheta": 0.3072192966938019,
      "pose_rmse_dx": 0.1970709264278412,
      "pose_rmse_dy": 0.1657227724790573,
      "pose_rmse_mean": 0.22333768010139465,
      "rmse_dtheta": 0.03515464812517166,
      "rmse_dx": 0.017188530415296555,
      "rmse_dy": 0.015150393359363079,
      "rmse_mean": 0.022497858852148056,
      "rotation_flip": 0.007039774674922228,
      "sparse_tokens": 32121.0,
      "step": 115,
      "turn_loss": 0.22358742356300354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0053893328377624975,
      "grad_norm": 0.700267493724823,
      "learning_rate": 9.583333333333335e-06,
      "loss": 0.1388,
      "mae_dtheta": 0.01621774025261402,
      "mae_dx": 0.0038721361197531223,
      "mae_dy": 0.004342047031968832,
      "pose_mae_dtheta": 0.11997409164905548,
      "pose_mae_dx": 0.044655460864305496,
      "pose_mae_dy": 0.05898478627204895,
      "pose_rmse_dtheta": 0.2849748134613037,
      "pose_rmse_dx": 0.11455104500055313,
      "pose_rmse_dy": 0.18260721862316132,
      "pose_rmse_mean": 0.1940443515777588,
      "rmse_dtheta": 0.0316668339073658,
      "rmse_dx": 0.01162195485085249,
      "rmse_dy": 0.011308281682431698,
      "rmse_mean": 0.018199024721980095,
      "rotation_flip": 0.0019425019854679704,
      "sparse_tokens": 32089.0,
      "step": 116,
      "turn_loss": 0.17559731006622314,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30078.0,
      "epoch": 0.005435792603605278,
      "grad_norm": 0.6645532250404358,
      "learning_rate": 9.666666666666667e-06,
      "loss": 0.2056,
      "mae_dtheta": 0.0400640070438385,
      "mae_dx": 0.01786884106695652,
      "mae_dy": 0.005161398556083441,
      "pose_mae_dtheta": 0.3391931653022766,
      "pose_mae_dx": 0.13966000080108643,
      "pose_mae_dy": 0.06544748693704605,
      "pose_rmse_dtheta": 0.5653235912322998,
      "pose_rmse_dx": 0.286591500043869,
      "pose_rmse_dy": 0.1541375070810318,
      "pose_rmse_mean": 0.3353508710861206,
      "rmse_dtheta": 0.05730478838086128,
      "rmse_dx": 0.031152473762631416,
      "rmse_dy": 0.009725802578032017,
      "rmse_mean": 0.0327276885509491,
      "rotation_flip": 0.012578615918755531,
      "sparse_tokens": 23278.0,
      "step": 117,
      "turn_loss": 0.3320448398590088,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.005482252369448058,
      "grad_norm": 0.46041807532310486,
      "learning_rate": 9.75e-06,
      "loss": 0.0757,
      "mae_dtheta": 0.006936162710189819,
      "mae_dx": 0.0016816825373098254,
      "mae_dy": 0.0010916793253272772,
      "pose_mae_dtheta": 0.05146341770887375,
      "pose_mae_dx": 0.01832694560289383,
      "pose_mae_dy": 0.017490943893790245,
      "pose_rmse_dtheta": 0.15784086287021637,
      "pose_rmse_dx": 0.045523449778556824,
      "pose_rmse_dy": 0.04769521206617355,
      "pose_rmse_mean": 0.08368651568889618,
      "rmse_dtheta": 0.02014348655939102,
      "rmse_dx": 0.0053640506230294704,
      "rmse_dy": 0.0025873335544019938,
      "rmse_mean": 0.009364956989884377,
      "rotation_flip": 0.003237992525100708,
      "sparse_tokens": 32137.0,
      "step": 118,
      "turn_loss": 0.04895761236548424,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.005528712135290838,
      "grad_norm": 0.5838584303855896,
      "learning_rate": 9.833333333333333e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.012742486782371998,
      "mae_dx": 0.002783267991617322,
      "mae_dy": 0.003137088380753994,
      "pose_mae_dtheta": 0.09162258356809616,
      "pose_mae_dx": 0.03469553217291832,
      "pose_mae_dy": 0.044119592756032944,
      "pose_rmse_dtheta": 0.1810857504606247,
      "pose_rmse_dx": 0.08765695989131927,
      "pose_rmse_dy": 0.09518902748823166,
      "pose_rmse_mean": 0.12131058424711227,
      "rmse_dtheta": 0.024268725886940956,
      "rmse_dx": 0.00844302587211132,
      "rmse_dy": 0.006476606708019972,
      "rmse_mean": 0.013062786310911179,
      "rotation_flip": 0.004775169305503368,
      "sparse_tokens": 32073.0,
      "step": 119,
      "turn_loss": 0.1198604628443718,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0055751719011336185,
      "grad_norm": 0.6011127829551697,
      "learning_rate": 9.916666666666668e-06,
      "loss": 0.1501,
      "mae_dtheta": 0.009378379210829735,
      "mae_dx": 0.0027054494712501764,
      "mae_dy": 0.002575541380792856,
      "pose_mae_dtheta": 0.06566525995731354,
      "pose_mae_dx": 0.02059006690979004,
      "pose_mae_dy": 0.030621269717812538,
      "pose_rmse_dtheta": 0.14967180788516998,
      "pose_rmse_dx": 0.052116114646196365,
      "pose_rmse_dy": 0.06962287425994873,
      "pose_rmse_mean": 0.09047026932239532,
      "rmse_dtheta": 0.019361412152647972,
      "rmse_dx": 0.008369321934878826,
      "rmse_dy": 0.006635132245719433,
      "rmse_mean": 0.011455289088189602,
      "rotation_flip": 0.003327786922454834,
      "sparse_tokens": 32089.0,
      "step": 120,
      "turn_loss": 0.08440764993429184,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10407.0,
      "epoch": 0.005621631666976399,
      "grad_norm": 0.5822030305862427,
      "learning_rate": 1e-05,
      "loss": 0.176,
      "mae_dtheta": 0.024918856099247932,
      "mae_dx": 0.009335429407656193,
      "mae_dy": 0.0026436334010213614,
      "pose_mae_dtheta": 0.18159565329551697,
      "pose_mae_dx": 0.07004628330469131,
      "pose_mae_dy": 0.03571590408682823,
      "pose_rmse_dtheta": 0.39712610840797424,
      "pose_rmse_dx": 0.1786372810602188,
      "pose_rmse_dy": 0.07918625324964523,
      "pose_rmse_mean": 0.21831655502319336,
      "rmse_dtheta": 0.046213798224925995,
      "rmse_dx": 0.021097993478178978,
      "rmse_dy": 0.005215353332459927,
      "rmse_mean": 0.024175716564059258,
      "rotation_flip": 0.007389162667095661,
      "sparse_tokens": 8838.0,
      "step": 121,
      "turn_loss": 0.16763576865196228,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.005668091432819178,
      "grad_norm": 0.5598973631858826,
      "learning_rate": 9.99999982517366e-06,
      "loss": 0.147,
      "mae_dtheta": 0.010921907611191273,
      "mae_dx": 0.001998797059059143,
      "mae_dy": 0.00239192764274776,
      "pose_mae_dtheta": 0.08492596447467804,
      "pose_mae_dx": 0.025055719539523125,
      "pose_mae_dy": 0.03194333240389824,
      "pose_rmse_dtheta": 0.22494924068450928,
      "pose_rmse_dx": 0.06264748424291611,
      "pose_rmse_dy": 0.07305923849344254,
      "pose_rmse_mean": 0.1202186569571495,
      "rmse_dtheta": 0.024514831602573395,
      "rmse_dx": 0.005228045862168074,
      "rmse_dy": 0.005582907702773809,
      "rmse_mean": 0.011775261722505093,
      "rotation_flip": 0.004545454401522875,
      "sparse_tokens": 32089.0,
      "step": 122,
      "turn_loss": 0.07701840251684189,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32662.0,
      "epoch": 0.005714551198661958,
      "grad_norm": 0.6203091740608215,
      "learning_rate": 9.999999300694644e-06,
      "loss": 0.169,
      "mae_dtheta": 0.03810325264930725,
      "mae_dx": 0.012571178376674652,
      "mae_dy": 0.005400282330811024,
      "pose_mae_dtheta": 0.2853570878505707,
      "pose_mae_dx": 0.10445650666952133,
      "pose_mae_dy": 0.06800980865955353,
      "pose_rmse_dtheta": 0.49348095059394836,
      "pose_rmse_dx": 0.21443913877010345,
      "pose_rmse_dy": 0.1536281853914261,
      "pose_rmse_mean": 0.2871827483177185,
      "rmse_dtheta": 0.05601605027914047,
      "rmse_dx": 0.024083619937300682,
      "rmse_dy": 0.010337079875171185,
      "rmse_mean": 0.030145583674311638,
      "rotation_flip": 0.005940594244748354,
      "sparse_tokens": 26332.0,
      "step": 123,
      "turn_loss": 0.31306517124176025,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.005761010964504739,
      "grad_norm": 0.7374018430709839,
      "learning_rate": 9.999998426562997e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.010962327942252159,
      "mae_dx": 0.002166738035157323,
      "mae_dy": 0.002548270160332322,
      "pose_mae_dtheta": 0.07614469528198242,
      "pose_mae_dx": 0.03172977641224861,
      "pose_mae_dy": 0.036354418843984604,
      "pose_rmse_dtheta": 0.1528845876455307,
      "pose_rmse_dx": 0.08587471395730972,
      "pose_rmse_dy": 0.08574721962213516,
      "pose_rmse_mean": 0.1081688404083252,
      "rmse_dtheta": 0.020492281764745712,
      "rmse_dx": 0.006784807424992323,
      "rmse_dy": 0.005158447194844484,
      "rmse_mean": 0.010811845771968365,
      "rotation_flip": 0.004610065370798111,
      "sparse_tokens": 32089.0,
      "step": 124,
      "turn_loss": 0.08151775598526001,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.005807470730347519,
      "grad_norm": 0.6654586791992188,
      "learning_rate": 9.999997202778775e-06,
      "loss": 0.2213,
      "mae_dtheta": 0.014768983237445354,
      "mae_dx": 0.0034699556417763233,
      "mae_dy": 0.0037408028729259968,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6654587984085083,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 144.5025177001953,
      "model/head/act_norm_mean": 104.33268229166667,
      "model/head/act_norm_min": 64.00884246826172,
      "model/head/act_over_embed": 71.69839604879434,
      "model/head/grad_frac": 0.11620581895112991,
      "model/head/grad_norm": 0.07733018696308136,
      "model/head/grad_zero_frac": 0.00020273665722925216,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6839192708333334,
      "model/head/update_ratio": 0.001356109045445919,
      "model/head/weight_delta": 1.115169644355774,
      "model/head/weight_delta_rel": 0.019563378766179085,
      "model/head/weight_norm": 57.02357482910156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.408913254737854,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4088499202284702,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4087696075439453,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28096549289426453,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06392619758844376,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04254024848341942,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5014625726744186,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013897931203246117,
      "model/modality_embedder.encoders.pose/weight_delta": 0.2987287640571594,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.009760399349033833,
      "model/modality_embedder.encoders.pose/weight_norm": 30.609050750732422,
      "model/modality_embedder/grad_frac": 0.06392619758844376,
      "model/modality_embedder/grad_norm": 0.04254024848341942,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5014625726744186,
      "model/modality_embedder/update_ratio": 0.0013897931203246117,
      "model/modality_embedder/weight_delta": 0.2987287640571594,
      "model/modality_embedder/weight_delta_rel": 0.009760399349033833,
      "model/modality_embedder/weight_norm": 30.609050750732422,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.97514343261719,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.6829179693763,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.895469665527344,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.587913589379223,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07886257022619247,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05247979238629341,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019120076904073358,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.14264148473739624,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.005197941791266203,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.447479248046875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.5247573852539,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.762195366362032,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.309439659118652,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.329603120942004,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08243595063686371,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.054857730865478516,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018996192375198007,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.14801016449928284,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.005127187818288803,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.878276824951172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.29371643066406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.70657968574635,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.44770622253418,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.66580222883571,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0895184725522995,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.059570856392383575,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019994755275547504,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.14024928212165833,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.004709308501332998,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.79323959350586,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.29521179199219,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.663587762546097,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.007611274719238,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.010676501010774,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10589851438999176,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07047110050916672,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002407579682767391,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.11845415830612183,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.004048200789839029,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.270517349243164,
      "model/normalizer/grad_frac": 0.356971800327301,
      "model/normalizer/grad_norm": 0.2375500202178955,
      "model/normalizer/grad_zero_frac": 0.00021034943347331136,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0030590423848479986,
      "model/normalizer/weight_delta": 0.2841671109199524,
      "model/normalizer/weight_delta_rel": 0.0036599079612642527,
      "model/normalizer/weight_norm": 77.655029296875,
      "pose_mae_dtheta": 0.10688802599906921,
      "pose_mae_dx": 0.04324072599411011,
      "pose_mae_dy": 0.049971479922533035,
      "pose_rmse_dtheta": 0.2111227661371231,
      "pose_rmse_dx": 0.11923587322235107,
      "pose_rmse_dy": 0.10900385677814484,
      "pose_rmse_mean": 0.14645415544509888,
      "rmse_dtheta": 0.027248207479715347,
      "rmse_dx": 0.011287684552371502,
      "rmse_dy": 0.007833373732864857,
      "rmse_mean": 0.015456422232091427,
      "rotation_flip": 0.005311077460646629,
      "sparse_tokens": 32041.0,
      "step": 125,
      "turn_loss": 0.13734374940395355,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.005853930496190299,
      "grad_norm": 0.5674776434898376,
      "learning_rate": 9.999995629342067e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.03250462934374809,
      "mae_dx": 0.007526613771915436,
      "mae_dy": 0.004708407912403345,
      "pose_mae_dtheta": 0.24557287991046906,
      "pose_mae_dx": 0.040894657373428345,
      "pose_mae_dy": 0.06588619947433472,
      "pose_rmse_dtheta": 0.38870248198509216,
      "pose_rmse_dx": 0.08675015717744827,
      "pose_rmse_dy": 0.13095080852508545,
      "pose_rmse_mean": 0.20213449001312256,
      "rmse_dtheta": 0.04519151896238327,
      "rmse_dx": 0.017155487090349197,
      "rmse_dy": 0.010078784078359604,
      "rmse_mean": 0.024141930043697357,
      "rotation_flip": 0.009999999776482582,
      "sparse_tokens": 3221.0,
      "step": 126,
      "turn_loss": 0.19884121417999268,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.005900390262033079,
      "grad_norm": 0.6750222444534302,
      "learning_rate": 9.999993706252978e-06,
      "loss": 0.1582,
      "mae_dtheta": 0.04829457774758339,
      "mae_dx": 0.014399128034710884,
      "mae_dy": 0.005798874422907829,
      "pose_mae_dtheta": 0.42906683683395386,
      "pose_mae_dx": 0.12972380220890045,
      "pose_mae_dy": 0.05575958266854286,
      "pose_rmse_dtheta": 0.6278908848762512,
      "pose_rmse_dx": 0.26273998618125916,
      "pose_rmse_dy": 0.14008302986621857,
      "pose_rmse_mean": 0.3435713052749634,
      "rmse_dtheta": 0.0636201724410057,
      "rmse_dx": 0.026288632303476334,
      "rmse_dy": 0.012144585140049458,
      "rmse_mean": 0.03401780128479004,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 12422.0,
      "step": 127,
      "turn_loss": 0.3574931025505066,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.00594685002787586,
      "grad_norm": 0.6363945603370667,
      "learning_rate": 9.999991433511647e-06,
      "loss": 0.1542,
      "mae_dtheta": 0.014197146520018578,
      "mae_dx": 0.002764563076198101,
      "mae_dy": 0.004975658375769854,
      "pose_mae_dtheta": 0.10879022628068924,
      "pose_mae_dx": 0.04131864011287689,
      "pose_mae_dy": 0.05319540575146675,
      "pose_rmse_dtheta": 0.24547834694385529,
      "pose_rmse_dx": 0.11156322807073593,
      "pose_rmse_dy": 0.1430676132440567,
      "pose_rmse_mean": 0.16670307517051697,
      "rmse_dtheta": 0.02867300622165203,
      "rmse_dx": 0.008001789450645447,
      "rmse_dy": 0.012404020875692368,
      "rmse_mean": 0.016359606757760048,
      "rotation_flip": 0.00699300691485405,
      "sparse_tokens": 32057.0,
      "step": 128,
      "turn_loss": 0.15177179872989655,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.00599330979371864,
      "grad_norm": 0.6869566440582275,
      "learning_rate": 9.999988811118232e-06,
      "loss": 0.1357,
      "mae_dtheta": 0.008565975353121758,
      "mae_dx": 0.0033465365413576365,
      "mae_dy": 0.001038776827044785,
      "pose_mae_dtheta": 0.06488852947950363,
      "pose_mae_dx": 0.030996084213256836,
      "pose_mae_dy": 0.01835664175450802,
      "pose_rmse_dtheta": 0.19228558242321014,
      "pose_rmse_dx": 0.11158747225999832,
      "pose_rmse_dy": 0.051826607435941696,
      "pose_rmse_mean": 0.11856655776500702,
      "rmse_dtheta": 0.023507632315158844,
      "rmse_dx": 0.011438270099461079,
      "rmse_dy": 0.0024686134420335293,
      "rmse_mean": 0.012471504509449005,
      "rotation_flip": 0.0007468260009773076,
      "sparse_tokens": 32073.0,
      "step": 129,
      "turn_loss": 0.07450104504823685,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.00603976955956142,
      "grad_norm": 0.5368980169296265,
      "learning_rate": 9.999985839072914e-06,
      "loss": 0.1336,
      "mae_dtheta": 0.011416536755859852,
      "mae_dx": 0.0035226515028625727,
      "mae_dy": 0.002681234385818243,
      "pose_mae_dtheta": 0.07593240588903427,
      "pose_mae_dx": 0.03602319583296776,
      "pose_mae_dy": 0.030957233160734177,
      "pose_rmse_dtheta": 0.19217811524868011,
      "pose_rmse_dx": 0.087179034948349,
      "pose_rmse_dy": 0.0768815129995346,
      "pose_rmse_mean": 0.11874622106552124,
      "rmse_dtheta": 0.025868000462651253,
      "rmse_dx": 0.010848913341760635,
      "rmse_dy": 0.007064481265842915,
      "rmse_mean": 0.014593798667192459,
      "rotation_flip": 0.00516647519543767,
      "sparse_tokens": 32041.0,
      "step": 130,
      "turn_loss": 0.14283381402492523,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.0060862293254041995,
      "grad_norm": 0.5283242464065552,
      "learning_rate": 9.999982517375903e-06,
      "loss": 0.1428,
      "mae_dtheta": 0.04081684723496437,
      "mae_dx": 0.015043888241052628,
      "mae_dy": 0.003912300802767277,
      "pose_mae_dtheta": 0.32245010137557983,
      "pose_mae_dx": 0.12433572858572006,
      "pose_mae_dy": 0.052758604288101196,
      "pose_rmse_dtheta": 0.5368272662162781,
      "pose_rmse_dx": 0.2655523121356964,
      "pose_rmse_dy": 0.11956154555082321,
      "pose_rmse_mean": 0.3073137402534485,
      "rmse_dtheta": 0.05877862125635147,
      "rmse_dx": 0.027906162664294243,
      "rmse_dy": 0.007937232963740826,
      "rmse_mean": 0.03154067322611809,
      "rotation_flip": 0.02867383509874344,
      "sparse_tokens": 11116.0,
      "step": 131,
      "turn_loss": 0.2758674621582031,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 34063.0,
      "epoch": 0.00613268909124698,
      "grad_norm": 0.554161548614502,
      "learning_rate": 9.999978846027432e-06,
      "loss": 0.1296,
      "mae_dtheta": 0.0247969888150692,
      "mae_dx": 0.009248298592865467,
      "mae_dy": 0.003316482761874795,
      "pose_mae_dtheta": 0.1880318820476532,
      "pose_mae_dx": 0.07144611328840256,
      "pose_mae_dy": 0.04513620212674141,
      "pose_rmse_dtheta": 0.3244381844997406,
      "pose_rmse_dx": 0.17283126711845398,
      "pose_rmse_dy": 0.11309370398521423,
      "pose_rmse_mean": 0.2034543752670288,
      "rmse_dtheta": 0.03950824961066246,
      "rmse_dx": 0.020876538008451462,
      "rmse_dy": 0.007056828588247299,
      "rmse_mean": 0.022480538114905357,
      "rotation_flip": 0.012673506513237953,
      "sparse_tokens": 27877.0,
      "step": 132,
      "turn_loss": 0.19288617372512817,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.00617914885708976,
      "grad_norm": 0.7536580562591553,
      "learning_rate": 9.999974825027756e-06,
      "loss": 0.0925,
      "mae_dtheta": 0.007835429161787033,
      "mae_dx": 0.0023711100220680237,
      "mae_dy": 0.0012735666241496801,
      "pose_mae_dtheta": 0.056152816861867905,
      "pose_mae_dx": 0.025894207879900932,
      "pose_mae_dy": 0.020013099536299706,
      "pose_rmse_dtheta": 0.16727067530155182,
      "pose_rmse_dx": 0.08715354651212692,
      "pose_rmse_dy": 0.04983722046017647,
      "pose_rmse_mean": 0.10142048448324203,
      "rmse_dtheta": 0.021002119407057762,
      "rmse_dx": 0.008600201457738876,
      "rmse_dy": 0.003142109140753746,
      "rmse_mean": 0.010914810001850128,
      "rotation_flip": 0.0012987012742087245,
      "sparse_tokens": 32073.0,
      "step": 133,
      "turn_loss": 0.07465341687202454,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.00622560862293254,
      "grad_norm": 0.5399572849273682,
      "learning_rate": 9.999970454377157e-06,
      "loss": 0.1148,
      "mae_dtheta": 0.04994601756334305,
      "mae_dx": 0.01230247039347887,
      "mae_dy": 0.006537051405757666,
      "pose_mae_dtheta": 0.3888051509857178,
      "pose_mae_dx": 0.11068381369113922,
      "pose_mae_dy": 0.06992168724536896,
      "pose_rmse_dtheta": 0.6762498021125793,
      "pose_rmse_dx": 0.259925901889801,
      "pose_rmse_dy": 0.12559378147125244,
      "pose_rmse_mean": 0.35392317175865173,
      "rmse_dtheta": 0.06932993233203888,
      "rmse_dx": 0.026348339393734932,
      "rmse_dy": 0.011040077544748783,
      "rmse_mean": 0.035572782158851624,
      "rotation_flip": 0.0069204154424369335,
      "sparse_tokens": 4964.0,
      "step": 134,
      "turn_loss": 0.35433530807495117,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.0062720683887753205,
      "grad_norm": 0.49068373441696167,
      "learning_rate": 9.99996573407594e-06,
      "loss": 0.1549,
      "mae_dtheta": 0.030892714858055115,
      "mae_dx": 0.01081138662993908,
      "mae_dy": 0.007885436527431011,
      "pose_mae_dtheta": 0.23975646495819092,
      "pose_mae_dx": 0.08190800994634628,
      "pose_mae_dy": 0.08559828251600266,
      "pose_rmse_dtheta": 0.4462423324584961,
      "pose_rmse_dx": 0.19889101386070251,
      "pose_rmse_dy": 0.18876256048679352,
      "pose_rmse_mean": 0.2779653072357178,
      "rmse_dtheta": 0.04974104091525078,
      "rmse_dx": 0.022924235090613365,
      "rmse_dy": 0.016105731949210167,
      "rmse_mean": 0.029590336605906487,
      "rotation_flip": 0.018104366958141327,
      "sparse_tokens": 14582.0,
      "step": 135,
      "turn_loss": 0.27393248677253723,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.006318528154618101,
      "grad_norm": 0.7168368697166443,
      "learning_rate": 9.999960664124435e-06,
      "loss": 0.2025,
      "mae_dtheta": 0.01290201861411333,
      "mae_dx": 0.0033213398419320583,
      "mae_dy": 0.0031533706933259964,
      "pose_mae_dtheta": 0.09834513813257217,
      "pose_mae_dx": 0.0284060500562191,
      "pose_mae_dy": 0.03967927023768425,
      "pose_rmse_dtheta": 0.24947910010814667,
      "pose_rmse_dx": 0.081157386302948,
      "pose_rmse_dy": 0.10477560758590698,
      "pose_rmse_mean": 0.14513736963272095,
      "rmse_dtheta": 0.029113613069057465,
      "rmse_dx": 0.01054849848151207,
      "rmse_dy": 0.008570319972932339,
      "rmse_mean": 0.016077477484941483,
      "rotation_flip": 0.0038591413758695126,
      "sparse_tokens": 32089.0,
      "step": 136,
      "turn_loss": 0.13194169104099274,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.006364987920460881,
      "grad_norm": 0.7357114553451538,
      "learning_rate": 9.999955244522999e-06,
      "loss": 0.135,
      "mae_dtheta": 0.009143678471446037,
      "mae_dx": 0.00203056912869215,
      "mae_dy": 0.0023316959850490093,
      "pose_mae_dtheta": 0.05975600332021713,
      "pose_mae_dx": 0.028080472722649574,
      "pose_mae_dy": 0.02729586884379387,
      "pose_rmse_dtheta": 0.12855951488018036,
      "pose_rmse_dx": 0.06955217570066452,
      "pose_rmse_dy": 0.06633249670267105,
      "pose_rmse_mean": 0.08814805746078491,
      "rmse_dtheta": 0.019513927400112152,
      "rmse_dx": 0.0057520815171301365,
      "rmse_dy": 0.004997389856725931,
      "rmse_mean": 0.010087799280881882,
      "rotation_flip": 0.004019292537122965,
      "sparse_tokens": 32105.0,
      "step": 137,
      "turn_loss": 0.07720533013343811,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.006411447686303661,
      "grad_norm": 0.46587038040161133,
      "learning_rate": 9.999949475272009e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.024484047666192055,
      "mae_dx": 0.00926464144140482,
      "mae_dy": 0.0067397127859294415,
      "pose_mae_dtheta": 0.2197525054216385,
      "pose_mae_dx": 0.0815446749329567,
      "pose_mae_dy": 0.08114995807409286,
      "pose_rmse_dtheta": 0.4475943446159363,
      "pose_rmse_dx": 0.20649518072605133,
      "pose_rmse_dy": 0.18154416978359222,
      "pose_rmse_mean": 0.2785445749759674,
      "rmse_dtheta": 0.04367498680949211,
      "rmse_dx": 0.023210128769278526,
      "rmse_dy": 0.01735137216746807,
      "rmse_mean": 0.028078829869627953,
      "rotation_flip": 0.005167958792299032,
      "sparse_tokens": 10797.0,
      "step": 138,
      "turn_loss": 0.2526196837425232,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.0064579074521464415,
      "grad_norm": 0.6618245244026184,
      "learning_rate": 9.999943356371867e-06,
      "loss": 0.1545,
      "mae_dtheta": 0.010456053540110588,
      "mae_dx": 0.002054708544164896,
      "mae_dy": 0.0025123516097664833,
      "pose_mae_dtheta": 0.07593318819999695,
      "pose_mae_dx": 0.024596907198429108,
      "pose_mae_dy": 0.03373270854353905,
      "pose_rmse_dtheta": 0.1532789170742035,
      "pose_rmse_dx": 0.06434237957000732,
      "pose_rmse_dy": 0.08248291164636612,
      "pose_rmse_mean": 0.10003473609685898,
      "rmse_dtheta": 0.020491769537329674,
      "rmse_dx": 0.006781319156289101,
      "rmse_dy": 0.0054024579003453255,
      "rmse_mean": 0.010891849175095558,
      "rotation_flip": 0.003021148033440113,
      "sparse_tokens": 32073.0,
      "step": 139,
      "turn_loss": 0.08912945538759232,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.006504367217989221,
      "grad_norm": 0.5225594639778137,
      "learning_rate": 9.999936887823004e-06,
      "loss": 0.0852,
      "mae_dtheta": 0.009262285195291042,
      "mae_dx": 0.001762544154189527,
      "mae_dy": 0.0012169725960120559,
      "pose_mae_dtheta": 0.06880253553390503,
      "pose_mae_dx": 0.01789228804409504,
      "pose_mae_dy": 0.018253527581691742,
      "pose_rmse_dtheta": 0.22310569882392883,
      "pose_rmse_dx": 0.03929557278752327,
      "pose_rmse_dy": 0.04562683030962944,
      "pose_rmse_mean": 0.10267603397369385,
      "rmse_dtheta": 0.025989925488829613,
      "rmse_dx": 0.004853276070207357,
      "rmse_dy": 0.0024758209474384785,
      "rmse_mean": 0.011106341145932674,
      "rotation_flip": 0.002595155732706189,
      "sparse_tokens": 32169.0,
      "step": 140,
      "turn_loss": 0.07205887138843536,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32764.0,
      "epoch": 0.006550826983832001,
      "grad_norm": 0.7210275530815125,
      "learning_rate": 9.999930069625869e-06,
      "loss": 0.1475,
      "mae_dtheta": 0.03565961867570877,
      "mae_dx": 0.014481221325695515,
      "mae_dy": 0.004099160898476839,
      "pose_mae_dtheta": 0.2622283697128296,
      "pose_mae_dx": 0.11719855666160583,
      "pose_mae_dy": 0.04749837517738342,
      "pose_rmse_dtheta": 0.450508177280426,
      "pose_rmse_dx": 0.2681525647640228,
      "pose_rmse_dy": 0.11870206147432327,
      "pose_rmse_mean": 0.27912092208862305,
      "rmse_dtheta": 0.05372986942529678,
      "rmse_dx": 0.028503334149718285,
      "rmse_dy": 0.008478870615363121,
      "rmse_mean": 0.030237359926104546,
      "rotation_flip": 0.0162443146109581,
      "sparse_tokens": 25976.0,
      "step": 141,
      "turn_loss": 0.28072407841682434,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.006597286749674781,
      "grad_norm": 0.5107837915420532,
      "learning_rate": 9.999922901780941e-06,
      "loss": 0.0964,
      "mae_dtheta": 0.011689289472997189,
      "mae_dx": 0.002368186367675662,
      "mae_dy": 0.0034094802103936672,
      "pose_mae_dtheta": 0.09014617651700974,
      "pose_mae_dx": 0.040836986154317856,
      "pose_mae_dy": 0.04755838215351105,
      "pose_rmse_dtheta": 0.16799485683441162,
      "pose_rmse_dx": 0.10560016334056854,
      "pose_rmse_dy": 0.10791977494955063,
      "pose_rmse_mean": 0.1271716058254242,
      "rmse_dtheta": 0.020825034007430077,
      "rmse_dx": 0.006992568727582693,
      "rmse_dy": 0.007064606994390488,
      "rmse_mean": 0.011627404019236565,
      "rotation_flip": 0.002583979396149516,
      "sparse_tokens": 32057.0,
      "step": 142,
      "turn_loss": 0.0938427746295929,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30495.0,
      "epoch": 0.006643746515517562,
      "grad_norm": 0.701164186000824,
      "learning_rate": 9.999915384288723e-06,
      "loss": 0.1676,
      "mae_dtheta": 0.03266320377588272,
      "mae_dx": 0.008402012288570404,
      "mae_dy": 0.003879363415762782,
      "pose_mae_dtheta": 0.26279228925704956,
      "pose_mae_dx": 0.07331521064043045,
      "pose_mae_dy": 0.054233238101005554,
      "pose_rmse_dtheta": 0.45763593912124634,
      "pose_rmse_dx": 0.17827284336090088,
      "pose_rmse_dy": 0.12504765391349792,
      "pose_rmse_mean": 0.2536521553993225,
      "rmse_dtheta": 0.05086824670433998,
      "rmse_dx": 0.01972026750445366,
      "rmse_dy": 0.007800048682838678,
      "rmse_mean": 0.026129521429538727,
      "rotation_flip": 0.010217983275651932,
      "sparse_tokens": 24130.0,
      "step": 143,
      "turn_loss": 0.22420424222946167,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 27816.0,
      "epoch": 0.006690206281360342,
      "grad_norm": 0.6254284977912903,
      "learning_rate": 9.999907517149737e-06,
      "loss": 0.189,
      "mae_dtheta": 0.03363857418298721,
      "mae_dx": 0.012186301872134209,
      "mae_dy": 0.0036639319732785225,
      "pose_mae_dtheta": 0.2737274467945099,
      "pose_mae_dx": 0.09736951440572739,
      "pose_mae_dy": 0.0471109114587307,
      "pose_rmse_dtheta": 0.4899830222129822,
      "pose_rmse_dx": 0.23086221516132355,
      "pose_rmse_dy": 0.09607800841331482,
      "pose_rmse_mean": 0.27230775356292725,
      "rmse_dtheta": 0.05175916478037834,
      "rmse_dx": 0.024863651022315025,
      "rmse_dy": 0.00730007654055953,
      "rmse_mean": 0.02797429822385311,
      "rotation_flip": 0.008799999952316284,
      "sparse_tokens": 23197.0,
      "step": 144,
      "turn_loss": 0.265531450510025,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.006736666047203122,
      "grad_norm": 0.5688682198524475,
      "learning_rate": 9.999899300364534e-06,
      "loss": 0.1513,
      "mae_dtheta": 0.007036477327346802,
      "mae_dx": 0.0018125625792890787,
      "mae_dy": 0.0009052201639860868,
      "pose_mae_dtheta": 0.052194997668266296,
      "pose_mae_dx": 0.01618887297809124,
      "pose_mae_dy": 0.012903059832751751,
      "pose_rmse_dtheta": 0.18500861525535583,
      "pose_rmse_dx": 0.044480063021183014,
      "pose_rmse_dy": 0.03303813189268112,
      "pose_rmse_mean": 0.08750893920660019,
      "rmse_dtheta": 0.021549176424741745,
      "rmse_dx": 0.00572338467463851,
      "rmse_dy": 0.0019417493604123592,
      "rmse_mean": 0.009738104417920113,
      "rotation_flip": 0.003763440763577819,
      "sparse_tokens": 32169.0,
      "step": 145,
      "turn_loss": 0.04564246907830238,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8116.0,
      "epoch": 0.006783125813045902,
      "grad_norm": 1.189090371131897,
      "learning_rate": 9.99989073393369e-06,
      "loss": 0.2983,
      "mae_dtheta": 0.04122820496559143,
      "mae_dx": 0.01067760493606329,
      "mae_dy": 0.0070349108427762985,
      "pose_mae_dtheta": 0.3064931035041809,
      "pose_mae_dx": 0.09271540492773056,
      "pose_mae_dy": 0.09962419420480728,
      "pose_rmse_dtheta": 0.5668525099754333,
      "pose_rmse_dx": 0.2168969213962555,
      "pose_rmse_dy": 0.1638420820236206,
      "pose_rmse_mean": 0.31586384773254395,
      "rmse_dtheta": 0.0588482990860939,
      "rmse_dx": 0.02386091835796833,
      "rmse_dy": 0.010508507490158081,
      "rmse_mean": 0.031072575598955154,
      "rotation_flip": 0.0027027027681469917,
      "sparse_tokens": 6823.0,
      "step": 146,
      "turn_loss": 0.3473086953163147,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.006829585578888683,
      "grad_norm": 0.4611382484436035,
      "learning_rate": 9.999881817857802e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.03843158856034279,
      "mae_dx": 0.018750902265310287,
      "mae_dy": 0.005120479501783848,
      "pose_mae_dtheta": 0.31789642572402954,
      "pose_mae_dx": 0.15817932784557343,
      "pose_mae_dy": 0.07663434743881226,
      "pose_rmse_dtheta": 0.5015668869018555,
      "pose_rmse_dx": 0.2935914993286133,
      "pose_rmse_dy": 0.16666825115680695,
      "pose_rmse_mean": 0.32060888409614563,
      "rmse_dtheta": 0.054739076644182205,
      "rmse_dx": 0.03129725530743599,
      "rmse_dy": 0.009122218936681747,
      "rmse_mean": 0.03171951696276665,
      "rotation_flip": 0.016344724223017693,
      "sparse_tokens": 13162.0,
      "step": 147,
      "turn_loss": 0.323723167181015,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 15917.0,
      "epoch": 0.006876045344731463,
      "grad_norm": 0.5741398930549622,
      "learning_rate": 9.999872552137497e-06,
      "loss": 0.1338,
      "mae_dtheta": 0.022055020555853844,
      "mae_dx": 0.0070933932438492775,
      "mae_dy": 0.0031257709488272667,
      "pose_mae_dtheta": 0.1673503965139389,
      "pose_mae_dx": 0.053177375346422195,
      "pose_mae_dy": 0.038901254534721375,
      "pose_rmse_dtheta": 0.3022395074367523,
      "pose_rmse_dx": 0.12398631125688553,
      "pose_rmse_dy": 0.09570365399122238,
      "pose_rmse_mean": 0.17397648096084595,
      "rmse_dtheta": 0.03686940297484398,
      "rmse_dx": 0.016502026468515396,
      "rmse_dy": 0.006407193373888731,
      "rmse_mean": 0.01992620900273323,
      "rotation_flip": 0.011128775775432587,
      "sparse_tokens": 13105.0,
      "step": 148,
      "turn_loss": 0.1851176619529724,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.006922505110574242,
      "grad_norm": 0.6505301594734192,
      "learning_rate": 9.99986293677342e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.033442024141550064,
      "mae_dx": 0.008544561453163624,
      "mae_dy": 0.004040650557726622,
      "pose_mae_dtheta": 0.26388588547706604,
      "pose_mae_dx": 0.07055827975273132,
      "pose_mae_dy": 0.04744153842329979,
      "pose_rmse_dtheta": 0.5212926864624023,
      "pose_rmse_dx": 0.1761377453804016,
      "pose_rmse_dy": 0.11724906414747238,
      "pose_rmse_mean": 0.27155983448028564,
      "rmse_dtheta": 0.05415124446153641,
      "rmse_dx": 0.018301280215382576,
      "rmse_dy": 0.007720721419900656,
      "rmse_mean": 0.02672441676259041,
      "rotation_flip": 0.015050167217850685,
      "sparse_tokens": 11951.0,
      "step": 149,
      "turn_loss": 0.2275666743516922,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 27902.0,
      "epoch": 0.0069689648764170225,
      "grad_norm": 1.298858642578125,
      "learning_rate": 9.999852971766244e-06,
      "loss": 0.3167,
      "mae_dtheta": 0.031532756984233856,
      "mae_dx": 0.010982414707541466,
      "mae_dy": 0.005232797469943762,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999992251396179,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.30142211914062,
      "model/head/act_norm_mean": 105.0740597747093,
      "model/head/act_norm_min": 55.5042724609375,
      "model/head/act_over_embed": 72.20787759602658,
      "model/head/grad_frac": 0.1298927664756775,
      "model/head/grad_norm": 0.12989266216754913,
      "model/head/grad_zero_frac": 0.00015895316028036177,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.681140988372093,
      "model/head/update_ratio": 0.0022774753160774708,
      "model/head/weight_delta": 1.2955397367477417,
      "model/head/weight_delta_rel": 0.0227276049554348,
      "model/head/weight_norm": 57.03361892700195,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4091176986694336,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.40906393116918105,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.40900149941444397,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.281112563216323,
      "model/modality_embedder.encoders.pose/grad_frac": 0.040162909775972366,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04016287997364998,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.49582435344827586,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013120098737999797,
      "model/modality_embedder.encoders.pose/weight_delta": 0.3584408462047577,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.011711379513144493,
      "model/modality_embedder.encoders.pose/weight_norm": 30.61172103881836,
      "model/modality_embedder/grad_frac": 0.040162909775972366,
      "model/modality_embedder/grad_norm": 0.04016287997364998,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.49582435344827586,
      "model/modality_embedder/update_ratio": 0.0013120098737999797,
      "model/modality_embedder/weight_delta": 0.3584408462047577,
      "model/modality_embedder/weight_delta_rel": 0.011711379513144493,
      "model/modality_embedder/weight_norm": 30.61172103881836,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.10617065429688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.753651024363233,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.822629928588867,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.636522006979536,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.13165506720542908,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.13165496289730072,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 7.06100690877065e-05,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.004796192049980164,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.1637374311685562,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.005966690834611654,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.449893951416016,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.73693084716797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.708490506183093,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.35164737701416,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.292696638234215,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.11157343536615372,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.11157334595918655,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.003862982615828514,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.17090515792369843,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.005920288152992725,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.882694244384766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.60676574707031,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.447112057032115,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.424856185913086,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.487493645209074,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.12032044678926468,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.12032034993171692,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.004037837032228708,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.16252698004245758,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.005457351449877024,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.7982177734375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.44927215576172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.44729951088963,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.923277854919434,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.862041189549934,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09553685039281845,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.09553677588701248,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.003263592952862382,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.13646402955055237,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0046636927872896194,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.273496627807617,
      "model/normalizer/grad_frac": 0.42068397998809814,
      "model/normalizer/grad_norm": 0.4206836521625519,
      "model/normalizer/grad_zero_frac": 0.00010399297752883285,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0054169949144124985,
      "model/normalizer/weight_delta": 0.3280906081199646,
      "model/normalizer/weight_delta_rel": 0.004225617274641991,
      "model/normalizer/weight_norm": 77.65996551513672,
      "pose_mae_dtheta": 0.22634758055210114,
      "pose_mae_dx": 0.09520251303911209,
      "pose_mae_dy": 0.06516852229833603,
      "pose_rmse_dtheta": 0.401166170835495,
      "pose_rmse_dx": 0.23407794535160065,
      "pose_rmse_dy": 0.15769048035144806,
      "pose_rmse_mean": 0.2643115520477295,
      "rmse_dtheta": 0.048930488526821136,
      "rmse_dx": 0.023758484050631523,
      "rmse_dy": 0.012820770964026451,
      "rmse_mean": 0.02850325033068657,
      "rotation_flip": 0.01131418626755476,
      "sparse_tokens": 23450.0,
      "step": 150,
      "turn_loss": 0.3071165978908539,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.007015424642259803,
      "grad_norm": 0.6341193318367004,
      "learning_rate": 9.999842657116667e-06,
      "loss": 0.1814,
      "mae_dtheta": 0.034090980887413025,
      "mae_dx": 0.010637298226356506,
      "mae_dy": 0.0050588930025696754,
      "pose_mae_dtheta": 0.27239081263542175,
      "pose_mae_dx": 0.07792363315820694,
      "pose_mae_dy": 0.07795792818069458,
      "pose_rmse_dtheta": 0.48072028160095215,
      "pose_rmse_dx": 0.18612311780452728,
      "pose_rmse_dy": 0.16443641483783722,
      "pose_rmse_mean": 0.2770932912826538,
      "rmse_dtheta": 0.05247544124722481,
      "rmse_dx": 0.022887462750077248,
      "rmse_dy": 0.008511386811733246,
      "rmse_mean": 0.02795809879899025,
      "rotation_flip": 0.021101992577314377,
      "sparse_tokens": 15454.0,
      "step": 151,
      "turn_loss": 0.2783510982990265,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 31791.0,
      "epoch": 0.007061884408102583,
      "grad_norm": 0.6091566681861877,
      "learning_rate": 9.999831992825409e-06,
      "loss": 0.153,
      "mae_dtheta": 0.03471862152218819,
      "mae_dx": 0.01025798637419939,
      "mae_dy": 0.0059243435971438885,
      "pose_mae_dtheta": 0.2618153691291809,
      "pose_mae_dx": 0.07468010485172272,
      "pose_mae_dy": 0.07814578711986542,
      "pose_rmse_dtheta": 0.4619925916194916,
      "pose_rmse_dx": 0.17398297786712646,
      "pose_rmse_dy": 0.19158479571342468,
      "pose_rmse_mean": 0.2758534848690033,
      "rmse_dtheta": 0.0531066432595253,
      "rmse_dx": 0.021914299577474594,
      "rmse_dy": 0.012312724255025387,
      "rmse_mean": 0.029111221432685852,
      "rotation_flip": 0.012698412872850895,
      "sparse_tokens": 25959.0,
      "step": 152,
      "turn_loss": 0.2476259171962738,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.007108344173945363,
      "grad_norm": 0.5586543679237366,
      "learning_rate": 9.999820978893216e-06,
      "loss": 0.1379,
      "mae_dtheta": 0.009800671599805355,
      "mae_dx": 0.001813613693229854,
      "mae_dy": 0.0015156054869294167,
      "pose_mae_dtheta": 0.07354684174060822,
      "pose_mae_dx": 0.016462499275803566,
      "pose_mae_dy": 0.02555845119059086,
      "pose_rmse_dtheta": 0.21818944811820984,
      "pose_rmse_dx": 0.04855990409851074,
      "pose_rmse_dy": 0.0601225271821022,
      "pose_rmse_mean": 0.10895729064941406,
      "rmse_dtheta": 0.02415389008820057,
      "rmse_dx": 0.006085908971726894,
      "rmse_dy": 0.00319207482971251,
      "rmse_mean": 0.011143958196043968,
      "rotation_flip": 0.005649717524647713,
      "sparse_tokens": 32105.0,
      "step": 153,
      "turn_loss": 0.06756787747144699,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.0071548039397881435,
      "grad_norm": 0.607666552066803,
      "learning_rate": 9.999809615320857e-06,
      "loss": 0.1494,
      "mae_dtheta": 0.032286472618579865,
      "mae_dx": 0.01011161133646965,
      "mae_dy": 0.004659284371882677,
      "pose_mae_dtheta": 0.2612639367580414,
      "pose_mae_dx": 0.07750438898801804,
      "pose_mae_dy": 0.06056054309010506,
      "pose_rmse_dtheta": 0.46985211968421936,
      "pose_rmse_dx": 0.1611228883266449,
      "pose_rmse_dy": 0.1329999417066574,
      "pose_rmse_mean": 0.2546583414077759,
      "rmse_dtheta": 0.05090091750025749,
      "rmse_dx": 0.020450875163078308,
      "rmse_dy": 0.008939606137573719,
      "rmse_mean": 0.026763802394270897,
      "rotation_flip": 0.013133208267390728,
      "sparse_tokens": 7879.0,
      "step": 154,
      "turn_loss": 0.24153326451778412,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.007201263705630924,
      "grad_norm": 0.6345298886299133,
      "learning_rate": 9.999797902109129e-06,
      "loss": 0.2056,
      "mae_dtheta": 0.015030920505523682,
      "mae_dx": 0.004143469966948032,
      "mae_dy": 0.004730413667857647,
      "pose_mae_dtheta": 0.10497559607028961,
      "pose_mae_dx": 0.051405493170022964,
      "pose_mae_dy": 0.05528046563267708,
      "pose_rmse_dtheta": 0.26210618019104004,
      "pose_rmse_dx": 0.1364358365535736,
      "pose_rmse_dy": 0.148972749710083,
      "pose_rmse_mean": 0.18250493705272675,
      "rmse_dtheta": 0.030608778819441795,
      "rmse_dx": 0.011707577854394913,
      "rmse_dy": 0.011060114949941635,
      "rmse_mean": 0.01779215782880783,
      "rotation_flip": 0.007249141577631235,
      "sparse_tokens": 32089.0,
      "step": 155,
      "turn_loss": 0.16123183071613312,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.007247723471473704,
      "grad_norm": 0.8688462972640991,
      "learning_rate": 9.999785839258851e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.0355660542845726,
      "mae_dx": 0.016157884150743484,
      "mae_dy": 0.007405586540699005,
      "pose_mae_dtheta": 0.29643282294273376,
      "pose_mae_dx": 0.1375727653503418,
      "pose_mae_dy": 0.11086762696504593,
      "pose_rmse_dtheta": 0.5180751085281372,
      "pose_rmse_dx": 0.2946856617927551,
      "pose_rmse_dy": 0.25885701179504395,
      "pose_rmse_mean": 0.35720595717430115,
      "rmse_dtheta": 0.05270971730351448,
      "rmse_dx": 0.029976950958371162,
      "rmse_dy": 0.014309611171483994,
      "rmse_mean": 0.03233209252357483,
      "rotation_flip": 0.0044052861630916595,
      "sparse_tokens": 11702.0,
      "step": 156,
      "turn_loss": 0.2980538010597229,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.007294183237316484,
      "grad_norm": 0.7080024480819702,
      "learning_rate": 9.999773426770864e-06,
      "loss": 0.1665,
      "mae_dtheta": 0.011218627914786339,
      "mae_dx": 0.002980716759338975,
      "mae_dy": 0.002642898354679346,
      "pose_mae_dtheta": 0.07856187969446182,
      "pose_mae_dx": 0.03350834175944328,
      "pose_mae_dy": 0.03143508732318878,
      "pose_rmse_dtheta": 0.1640632450580597,
      "pose_rmse_dx": 0.07645990699529648,
      "pose_rmse_dy": 0.07505232095718384,
      "pose_rmse_mean": 0.10519182682037354,
      "rmse_dtheta": 0.02218303456902504,
      "rmse_dx": 0.007763038855046034,
      "rmse_dy": 0.005531699862331152,
      "rmse_mean": 0.0118259247392416,
      "rotation_flip": 0.00741015188395977,
      "sparse_tokens": 32153.0,
      "step": 157,
      "turn_loss": 0.1091114804148674,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.007340643003159264,
      "grad_norm": 0.5418881773948669,
      "learning_rate": 9.99976066464604e-06,
      "loss": 0.1798,
      "mae_dtheta": 0.04315477982163429,
      "mae_dx": 0.011468764394521713,
      "mae_dy": 0.005164778791368008,
      "pose_mae_dtheta": 0.3297359049320221,
      "pose_mae_dx": 0.0911579504609108,
      "pose_mae_dy": 0.056701235473155975,
      "pose_rmse_dtheta": 0.5762684345245361,
      "pose_rmse_dx": 0.19656606018543243,
      "pose_rmse_dy": 0.1566423624753952,
      "pose_rmse_mean": 0.3098256289958954,
      "rmse_dtheta": 0.06171948462724686,
      "rmse_dx": 0.02281995303928852,
      "rmse_dy": 0.012603597715497017,
      "rmse_mean": 0.03238101303577423,
      "rotation_flip": 0.01515151560306549,
      "sparse_tokens": 20373.0,
      "step": 158,
      "turn_loss": 0.3243458569049835,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.007387102769002044,
      "grad_norm": 0.5733690857887268,
      "learning_rate": 9.999747552885268e-06,
      "loss": 0.0884,
      "mae_dtheta": 0.011171597987413406,
      "mae_dx": 0.0022470331750810146,
      "mae_dy": 0.002736286725848913,
      "pose_mae_dtheta": 0.07555398344993591,
      "pose_mae_dx": 0.027267374098300934,
      "pose_mae_dy": 0.035964708775281906,
      "pose_rmse_dtheta": 0.1519646942615509,
      "pose_rmse_dx": 0.06652842462062836,
      "pose_rmse_dy": 0.08265814185142517,
      "pose_rmse_mean": 0.10038375854492188,
      "rmse_dtheta": 0.02151774987578392,
      "rmse_dx": 0.006927517708390951,
      "rmse_dy": 0.005316275637596846,
      "rmse_mean": 0.011253847740590572,
      "rotation_flip": 0.009595327079296112,
      "sparse_tokens": 32073.0,
      "step": 159,
      "turn_loss": 0.09422571957111359,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.007433562534844824,
      "grad_norm": 0.5281978845596313,
      "learning_rate": 9.999734091489465e-06,
      "loss": 0.1435,
      "mae_dtheta": 0.01365849282592535,
      "mae_dx": 0.00403297645971179,
      "mae_dy": 0.0028617605566978455,
      "pose_mae_dtheta": 0.09621772915124893,
      "pose_mae_dx": 0.0496835932135582,
      "pose_mae_dy": 0.03809388726949692,
      "pose_rmse_dtheta": 0.20860044658184052,
      "pose_rmse_dx": 0.118228018283844,
      "pose_rmse_dy": 0.0850483775138855,
      "pose_rmse_mean": 0.1372922956943512,
      "rmse_dtheta": 0.027372905984520912,
      "rmse_dx": 0.011074633337557316,
      "rmse_dy": 0.005803767126053572,
      "rmse_mean": 0.014750435948371887,
      "rotation_flip": 0.004981319885700941,
      "sparse_tokens": 32089.0,
      "step": 160,
      "turn_loss": 0.16006161272525787,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30077.0,
      "epoch": 0.007480022300687604,
      "grad_norm": 0.6050226092338562,
      "learning_rate": 9.999720280459576e-06,
      "loss": 0.2061,
      "mae_dtheta": 0.05024595186114311,
      "mae_dx": 0.016927162185311317,
      "mae_dy": 0.005651772953569889,
      "pose_mae_dtheta": 0.43255022168159485,
      "pose_mae_dx": 0.13303452730178833,
      "pose_mae_dy": 0.07525216788053513,
      "pose_rmse_dtheta": 0.694040834903717,
      "pose_rmse_dx": 0.24696429073810577,
      "pose_rmse_dy": 0.17723320424556732,
      "pose_rmse_mean": 0.3727461099624634,
      "rmse_dtheta": 0.06901545077562332,
      "rmse_dx": 0.028915518894791603,
      "rmse_dy": 0.011073281988501549,
      "rmse_mean": 0.03633475303649902,
      "rotation_flip": 0.013861386105418205,
      "sparse_tokens": 23206.0,
      "step": 161,
      "turn_loss": 0.35570141673088074,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.007526482066530385,
      "grad_norm": 0.6450862884521484,
      "learning_rate": 9.999706119796563e-06,
      "loss": 0.1864,
      "mae_dtheta": 0.03393208608031273,
      "mae_dx": 0.013430222868919373,
      "mae_dy": 0.010580448433756828,
      "pose_mae_dtheta": 0.24119679629802704,
      "pose_mae_dx": 0.10839328914880753,
      "pose_mae_dy": 0.10371918231248856,
      "pose_rmse_dtheta": 0.40521159768104553,
      "pose_rmse_dx": 0.22588571906089783,
      "pose_rmse_dy": 0.22437462210655212,
      "pose_rmse_mean": 0.28515732288360596,
      "rmse_dtheta": 0.0506276972591877,
      "rmse_dx": 0.027160242199897766,
      "rmse_dy": 0.02142162434756756,
      "rmse_mean": 0.033069856464862823,
      "rotation_flip": 0.016251353546977043,
      "sparse_tokens": 15294.0,
      "step": 162,
      "turn_loss": 0.39270085096359253,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.007572941832373165,
      "grad_norm": 0.5276318788528442,
      "learning_rate": 9.999691609501418e-06,
      "loss": 0.1579,
      "mae_dtheta": 0.01461687870323658,
      "mae_dx": 0.0029076747596263885,
      "mae_dy": 0.0035595835652202368,
      "pose_mae_dtheta": 0.09991580247879028,
      "pose_mae_dx": 0.03614705055952072,
      "pose_mae_dy": 0.04335450008511543,
      "pose_rmse_dtheta": 0.2524798810482025,
      "pose_rmse_dx": 0.10063488036394119,
      "pose_rmse_dy": 0.12061907351016998,
      "pose_rmse_mean": 0.1579112857580185,
      "rmse_dtheta": 0.030288012698292732,
      "rmse_dx": 0.008604863658547401,
      "rmse_dy": 0.007789289113134146,
      "rmse_mean": 0.015560721978545189,
      "rotation_flip": 0.007713073864579201,
      "sparse_tokens": 32073.0,
      "step": 163,
      "turn_loss": 0.1376272588968277,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.007619401598215945,
      "grad_norm": 0.8921213150024414,
      "learning_rate": 9.999676749575154e-06,
      "loss": 0.1593,
      "mae_dtheta": 0.04621567204594612,
      "mae_dx": 0.011798684485256672,
      "mae_dy": 0.005231793969869614,
      "pose_mae_dtheta": 0.4042527973651886,
      "pose_mae_dx": 0.07535016536712646,
      "pose_mae_dy": 0.04454588145017624,
      "pose_rmse_dtheta": 0.6854398250579834,
      "pose_rmse_dx": 0.19420196115970612,
      "pose_rmse_dy": 0.09305203706026077,
      "pose_rmse_mean": 0.32423126697540283,
      "rmse_dtheta": 0.06724008172750473,
      "rmse_dx": 0.02356468327343464,
      "rmse_dy": 0.011082848533987999,
      "rmse_mean": 0.033962540328502655,
      "rotation_flip": 0.009633911773562431,
      "sparse_tokens": 9117.0,
      "step": 164,
      "turn_loss": 0.3377632200717926,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.007665861364058725,
      "grad_norm": 0.5964710712432861,
      "learning_rate": 9.999661540018812e-06,
      "loss": 0.1671,
      "mae_dtheta": 0.048433590680360794,
      "mae_dx": 0.025646157562732697,
      "mae_dy": 0.007451536599546671,
      "pose_mae_dtheta": 0.4505613148212433,
      "pose_mae_dx": 0.1566811054944992,
      "pose_mae_dy": 0.11964196711778641,
      "pose_rmse_dtheta": 0.7058619260787964,
      "pose_rmse_dx": 0.27807751297950745,
      "pose_rmse_dy": 0.2580380439758301,
      "pose_rmse_mean": 0.4139924943447113,
      "rmse_dtheta": 0.06672458350658417,
      "rmse_dx": 0.03963199257850647,
      "rmse_dy": 0.013896347023546696,
      "rmse_mean": 0.04008430987596512,
      "rotation_flip": 0.011560693383216858,
      "sparse_tokens": 3034.0,
      "step": 165,
      "turn_loss": 0.36613890528678894,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.007712321129901506,
      "grad_norm": 0.8477665185928345,
      "learning_rate": 9.999645980833454e-06,
      "loss": 0.1763,
      "mae_dtheta": 0.039628926664590836,
      "mae_dx": 0.01246211864054203,
      "mae_dy": 0.003737345337867737,
      "pose_mae_dtheta": 0.3246551752090454,
      "pose_mae_dx": 0.1016320288181305,
      "pose_mae_dy": 0.03904295712709427,
      "pose_rmse_dtheta": 0.5958524346351624,
      "pose_rmse_dx": 0.22187839448451996,
      "pose_rmse_dy": 0.1195731982588768,
      "pose_rmse_mean": 0.31243467330932617,
      "rmse_dtheta": 0.06107952818274498,
      "rmse_dx": 0.02523202635347843,
      "rmse_dy": 0.010619637556374073,
      "rmse_mean": 0.032310400158166885,
      "rotation_flip": 0.007929515093564987,
      "sparse_tokens": 18703.0,
      "step": 166,
      "turn_loss": 0.25375598669052124,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.007758780895744286,
      "grad_norm": 0.6085090041160583,
      "learning_rate": 9.999630072020171e-06,
      "loss": 0.119,
      "mae_dtheta": 0.011764534749090672,
      "mae_dx": 0.003758620237931609,
      "mae_dy": 0.004327785223722458,
      "pose_mae_dtheta": 0.08246392756700516,
      "pose_mae_dx": 0.044027891010046005,
      "pose_mae_dy": 0.03633991628885269,
      "pose_rmse_dtheta": 0.1753397434949875,
      "pose_rmse_dx": 0.11846226453781128,
      "pose_rmse_dy": 0.08075080066919327,
      "pose_rmse_mean": 0.12485094368457794,
      "rmse_dtheta": 0.02330649085342884,
      "rmse_dx": 0.009513787925243378,
      "rmse_dy": 0.009371324442327023,
      "rmse_mean": 0.01406386774033308,
      "rotation_flip": 0.005765765905380249,
      "sparse_tokens": 32121.0,
      "step": 167,
      "turn_loss": 0.11961288005113602,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.007805240661587065,
      "grad_norm": 0.6604788303375244,
      "learning_rate": 9.999613813580074e-06,
      "loss": 0.1085,
      "mae_dtheta": 0.04310436546802521,
      "mae_dx": 0.013851875439286232,
      "mae_dy": 0.006060868036001921,
      "pose_mae_dtheta": 0.33763304352760315,
      "pose_mae_dx": 0.09826066344976425,
      "pose_mae_dy": 0.05904882773756981,
      "pose_rmse_dtheta": 0.48653644323349,
      "pose_rmse_dx": 0.2095787525177002,
      "pose_rmse_dy": 0.13814279437065125,
      "pose_rmse_mean": 0.27808600664138794,
      "rmse_dtheta": 0.05788174271583557,
      "rmse_dx": 0.02567681297659874,
      "rmse_dy": 0.012693066149950027,
      "rmse_mean": 0.03208387643098831,
      "rotation_flip": 0.02222222276031971,
      "sparse_tokens": 5905.0,
      "step": 168,
      "turn_loss": 0.406414657831192,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.007851700427429846,
      "grad_norm": 0.6436154246330261,
      "learning_rate": 9.999597205514298e-06,
      "loss": 0.1732,
      "mae_dtheta": 0.03985775262117386,
      "mae_dx": 0.013123446144163609,
      "mae_dy": 0.00657244585454464,
      "pose_mae_dtheta": 0.3428480327129364,
      "pose_mae_dx": 0.09880317747592926,
      "pose_mae_dy": 0.08649892359972,
      "pose_rmse_dtheta": 0.5812596082687378,
      "pose_rmse_dx": 0.23062868416309357,
      "pose_rmse_dy": 0.2129785418510437,
      "pose_rmse_mean": 0.3416222929954529,
      "rmse_dtheta": 0.05773943290114403,
      "rmse_dx": 0.02624787576496601,
      "rmse_dy": 0.014383414760231972,
      "rmse_mean": 0.03279024362564087,
      "rotation_flip": 0.013280212879180908,
      "sparse_tokens": 12726.0,
      "step": 169,
      "turn_loss": 0.2893662750720978,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.007898160193272627,
      "grad_norm": 0.5495336055755615,
      "learning_rate": 9.999580247824005e-06,
      "loss": 0.1377,
      "mae_dtheta": 0.010018638335168362,
      "mae_dx": 0.002096413401886821,
      "mae_dy": 0.0016977109480649233,
      "pose_mae_dtheta": 0.07280009984970093,
      "pose_mae_dx": 0.026984119787812233,
      "pose_mae_dy": 0.029456904157996178,
      "pose_rmse_dtheta": 0.16297335922718048,
      "pose_rmse_dx": 0.06355708837509155,
      "pose_rmse_dy": 0.06264454126358032,
      "pose_rmse_mean": 0.09639166295528412,
      "rmse_dtheta": 0.02124101109802723,
      "rmse_dx": 0.006290455814450979,
      "rmse_dy": 0.003058678237721324,
      "rmse_mean": 0.010196715593338013,
      "rotation_flip": 0.0024958401918411255,
      "sparse_tokens": 32105.0,
      "step": 170,
      "turn_loss": 0.08487807214260101,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33413.0,
      "epoch": 0.007944619959115407,
      "grad_norm": 0.6514206528663635,
      "learning_rate": 9.999562940510383e-06,
      "loss": 0.13,
      "mae_dtheta": 0.030863545835018158,
      "mae_dx": 0.01101573184132576,
      "mae_dy": 0.004000427667051554,
      "pose_mae_dtheta": 0.23222972452640533,
      "pose_mae_dx": 0.08791598677635193,
      "pose_mae_dy": 0.05238177254796028,
      "pose_rmse_dtheta": 0.46264955401420593,
      "pose_rmse_dx": 0.2122664898633957,
      "pose_rmse_dy": 0.1244310662150383,
      "pose_rmse_mean": 0.2664490342140198,
      "rmse_dtheta": 0.05137252435088158,
      "rmse_dx": 0.024094369262456894,
      "rmse_dy": 0.008367556147277355,
      "rmse_mean": 0.027944816276431084,
      "rotation_flip": 0.009482129476964474,
      "sparse_tokens": 25933.0,
      "step": 171,
      "turn_loss": 0.2297678142786026,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.007991079724958185,
      "grad_norm": 0.5407518744468689,
      "learning_rate": 9.999545283574641e-06,
      "loss": 0.0968,
      "mae_dtheta": 0.010142413899302483,
      "mae_dx": 0.0021031340584158897,
      "mae_dy": 0.002932533621788025,
      "pose_mae_dtheta": 0.0700431764125824,
      "pose_mae_dx": 0.024877451360225677,
      "pose_mae_dy": 0.030852627009153366,
      "pose_rmse_dtheta": 0.1596773862838745,
      "pose_rmse_dx": 0.06857767701148987,
      "pose_rmse_dy": 0.07464025169610977,
      "pose_rmse_mean": 0.10096510499715805,
      "rmse_dtheta": 0.022343412041664124,
      "rmse_dx": 0.006091173738241196,
      "rmse_dy": 0.007299356162548065,
      "rmse_mean": 0.011911313980817795,
      "rotation_flip": 0.003938730806112289,
      "sparse_tokens": 32089.0,
      "step": 172,
      "turn_loss": 0.09860499203205109,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.008037539490800966,
      "grad_norm": 0.64119952917099,
      "learning_rate": 9.999527277018016e-06,
      "loss": 0.1187,
      "mae_dtheta": 0.008683744817972183,
      "mae_dx": 0.0032301826868206263,
      "mae_dy": 0.0016100064385682344,
      "pose_mae_dtheta": 0.06254620850086212,
      "pose_mae_dx": 0.029689015820622444,
      "pose_mae_dy": 0.02470342442393303,
      "pose_rmse_dtheta": 0.19066877663135529,
      "pose_rmse_dx": 0.10435350984334946,
      "pose_rmse_dy": 0.06686600297689438,
      "pose_rmse_mean": 0.12062942981719971,
      "rmse_dtheta": 0.02333359234035015,
      "rmse_dx": 0.011280432343482971,
      "rmse_dy": 0.0036557605490088463,
      "rmse_mean": 0.012756596319377422,
      "rotation_flip": 0.004891684278845787,
      "sparse_tokens": 32041.0,
      "step": 173,
      "turn_loss": 0.0734487846493721,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.008083999256643746,
      "grad_norm": 0.7106488943099976,
      "learning_rate": 9.999508920841763e-06,
      "loss": 0.1478,
      "mae_dtheta": 0.01278478093445301,
      "mae_dx": 0.002571139484643936,
      "mae_dy": 0.0035707829520106316,
      "pose_mae_dtheta": 0.09177537262439728,
      "pose_mae_dx": 0.03243854269385338,
      "pose_mae_dy": 0.04073229432106018,
      "pose_rmse_dtheta": 0.22225379943847656,
      "pose_rmse_dx": 0.0796612799167633,
      "pose_rmse_dy": 0.11556950211524963,
      "pose_rmse_mean": 0.13916152715682983,
      "rmse_dtheta": 0.02648887410759926,
      "rmse_dx": 0.006802944466471672,
      "rmse_dy": 0.008537296205759048,
      "rmse_mean": 0.013943037949502468,
      "rotation_flip": 0.006369426846504211,
      "sparse_tokens": 32105.0,
      "step": 174,
      "turn_loss": 0.12995289266109467,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.008130459022486526,
      "grad_norm": 0.6202479004859924,
      "learning_rate": 9.999490215047167e-06,
      "loss": 0.1225,
      "mae_dtheta": 0.03700801730155945,
      "mae_dx": 0.015344208106398582,
      "mae_dy": 0.004056272562593222,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6202477216720581,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 109.05277252197266,
      "model/head/act_norm_mean": 83.97613846628289,
      "model/head/act_norm_min": 60.983089447021484,
      "model/head/act_over_embed": 57.70918855102466,
      "model/head/grad_frac": 0.11886440962553024,
      "model/head/grad_norm": 0.0737253800034523,
      "model/head/grad_zero_frac": 0.00015641498612239957,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6809724506578947,
      "model/head/update_ratio": 0.0012924260227009654,
      "model/head/weight_delta": 1.455384373664856,
      "model/head/weight_delta_rel": 0.025531752035021782,
      "model/head/weight_norm": 57.0441780090332,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.40892133116722107,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.40892133116722107,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.40892133116722107,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28101456715993384,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09511208534240723,
      "model/modality_embedder.encoders.pose/grad_norm": 0.058993056416511536,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019270041957497597,
      "model/modality_embedder.encoders.pose/weight_delta": 0.4156174659729004,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.013579517602920532,
      "model/modality_embedder.encoders.pose/weight_norm": 30.61387062072754,
      "model/modality_embedder/grad_frac": 0.09511208534240723,
      "model/modality_embedder/grad_norm": 0.058993056416511536,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0019270041957497597,
      "model/modality_embedder/weight_delta": 0.4156174659729004,
      "model/modality_embedder/weight_delta_rel": 0.013579517602920532,
      "model/modality_embedder/weight_norm": 30.61387062072754,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 61.05641555786133,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 20.674922984544693,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.216887474060059,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.208000636657708,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08904150128364563,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05522779002785683,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020118742249906063,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.1750376671552658,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.006378478370606899,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.45091438293457,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 62.65690994262695,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 21.62661373485798,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.724579811096191,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 14.86201143014218,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0963810384273529,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.059780120849609375,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002069423208013177,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.18700602650642395,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.006478034891188145,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.8873348236084,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 64.47965240478516,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 23.32246958542189,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.034536361694336,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.027419447502314,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10433673113584518,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06471461802721024,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002171505009755492,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.18066942691802979,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.006066541187465191,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.801734924316406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 64.88688659667969,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 25.357940750313283,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.13534164428711,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 17.426214288396967,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1314065158367157,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08150459080934525,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0027838924434036016,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.1542862206697464,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.005272770766168833,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.277204513549805,
      "model/normalizer/grad_frac": 0.4624916613101959,
      "model/normalizer/grad_norm": 0.286859393119812,
      "model/normalizer/grad_zero_frac": 0.00016426164074800909,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0036935745738446712,
      "model/normalizer/weight_delta": 0.36057546734809875,
      "model/normalizer/weight_delta_rel": 0.004644003231078386,
      "model/normalizer/weight_norm": 77.66443634033203,
      "pose_mae_dtheta": 0.3184836506843567,
      "pose_mae_dx": 0.13386940956115723,
      "pose_mae_dy": 0.04836304113268852,
      "pose_rmse_dtheta": 0.4953334331512451,
      "pose_rmse_dx": 0.25439849495887756,
      "pose_rmse_dy": 0.11900085210800171,
      "pose_rmse_mean": 0.2895776033401489,
      "rmse_dtheta": 0.05223923549056053,
      "rmse_dx": 0.02731155790388584,
      "rmse_dy": 0.007549934089183807,
      "rmse_mean": 0.02903357706964016,
      "rotation_flip": 0.022687608376145363,
      "sparse_tokens": 9354.0,
      "step": 175,
      "turn_loss": 0.3223962187767029,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.008176918788329306,
      "grad_norm": 0.7384992837905884,
      "learning_rate": 9.999471159635538e-06,
      "loss": 0.1491,
      "mae_dtheta": 0.03532472997903824,
      "mae_dx": 0.009439650923013687,
      "mae_dy": 0.005594953894615173,
      "pose_mae_dtheta": 0.27788418531417847,
      "pose_mae_dx": 0.061398621648550034,
      "pose_mae_dy": 0.07257848232984543,
      "pose_rmse_dtheta": 0.5633449554443359,
      "pose_rmse_dx": 0.16527694463729858,
      "pose_rmse_dy": 0.16620293259620667,
      "pose_rmse_mean": 0.298274964094162,
      "rmse_dtheta": 0.05800798535346985,
      "rmse_dx": 0.022422870621085167,
      "rmse_dy": 0.010343567468225956,
      "rmse_mean": 0.030258141458034515,
      "rotation_flip": 0.014869888313114643,
      "sparse_tokens": 9802.0,
      "step": 176,
      "turn_loss": 0.23233802616596222,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.008223378554172087,
      "grad_norm": 0.5957701206207275,
      "learning_rate": 9.999451754608208e-06,
      "loss": 0.1366,
      "mae_dtheta": 0.0394141860306263,
      "mae_dx": 0.023257093504071236,
      "mae_dy": 0.00499196769669652,
      "pose_mae_dtheta": 0.26734042167663574,
      "pose_mae_dx": 0.16942350566387177,
      "pose_mae_dy": 0.036821991205215454,
      "pose_rmse_dtheta": 0.46423715353012085,
      "pose_rmse_dx": 0.30488261580467224,
      "pose_rmse_dy": 0.09288119524717331,
      "pose_rmse_mean": 0.2873336672782898,
      "rmse_dtheta": 0.05930548906326294,
      "rmse_dx": 0.035435959696769714,
      "rmse_dy": 0.011303666979074478,
      "rmse_mean": 0.03534837067127228,
      "rotation_flip": 0.01744186133146286,
      "sparse_tokens": 3195.0,
      "step": 177,
      "turn_loss": 0.44156941771507263,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.008269838320014867,
      "grad_norm": 0.41812655329704285,
      "learning_rate": 9.999431999966532e-06,
      "loss": 0.0792,
      "mae_dtheta": 0.03161364793777466,
      "mae_dx": 0.012973967008292675,
      "mae_dy": 0.00521511398255825,
      "pose_mae_dtheta": 0.2639843225479126,
      "pose_mae_dx": 0.11600734293460846,
      "pose_mae_dy": 0.06540043652057648,
      "pose_rmse_dtheta": 0.44137290120124817,
      "pose_rmse_dx": 0.24095028638839722,
      "pose_rmse_dy": 0.13142353296279907,
      "pose_rmse_mean": 0.2712489366531372,
      "rmse_dtheta": 0.04591546580195427,
      "rmse_dx": 0.0255754217505455,
      "rmse_dy": 0.008422157727181911,
      "rmse_mean": 0.02663768082857132,
      "rotation_flip": 0.015471166931092739,
      "sparse_tokens": 11405.0,
      "step": 178,
      "turn_loss": 0.3241766691207886,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.008316298085857647,
      "grad_norm": 0.4164130687713623,
      "learning_rate": 9.999411895711895e-06,
      "loss": 0.0895,
      "mae_dtheta": 0.008975710719823837,
      "mae_dx": 0.002002626657485962,
      "mae_dy": 0.00230667507275939,
      "pose_mae_dtheta": 0.06236657872796059,
      "pose_mae_dx": 0.026274241507053375,
      "pose_mae_dy": 0.023745184764266014,
      "pose_rmse_dtheta": 0.17437735199928284,
      "pose_rmse_dx": 0.06823711097240448,
      "pose_rmse_dy": 0.05751866102218628,
      "pose_rmse_mean": 0.1000443696975708,
      "rmse_dtheta": 0.022141434252262115,
      "rmse_dx": 0.005690769292414188,
      "rmse_dy": 0.004990162327885628,
      "rmse_mean": 0.010940788313746452,
      "rotation_flip": 0.0024885940365493298,
      "sparse_tokens": 32105.0,
      "step": 179,
      "turn_loss": 0.07341031730175018,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.008362757851700427,
      "grad_norm": 0.7319294214248657,
      "learning_rate": 9.999391441845699e-06,
      "loss": 0.219,
      "mae_dtheta": 0.03230760246515274,
      "mae_dx": 0.013330639339983463,
      "mae_dy": 0.003194315591827035,
      "pose_mae_dtheta": 0.24231979250907898,
      "pose_mae_dx": 0.1072385311126709,
      "pose_mae_dy": 0.04213159158825874,
      "pose_rmse_dtheta": 0.4646483063697815,
      "pose_rmse_dx": 0.24621397256851196,
      "pose_rmse_dy": 0.10025401413440704,
      "pose_rmse_mean": 0.27037209272384644,
      "rmse_dtheta": 0.0510406456887722,
      "rmse_dx": 0.025199126452207565,
      "rmse_dy": 0.007152377162128687,
      "rmse_mean": 0.027797384187579155,
      "rotation_flip": 0.006535947788506746,
      "sparse_tokens": 6185.0,
      "step": 180,
      "turn_loss": 0.16676092147827148,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.008409217617543208,
      "grad_norm": 0.589123547077179,
      "learning_rate": 9.999370638369377e-06,
      "loss": 0.1373,
      "mae_dtheta": 0.011332646012306213,
      "mae_dx": 0.002925093984231353,
      "mae_dy": 0.0035433301236480474,
      "pose_mae_dtheta": 0.0810776874423027,
      "pose_mae_dx": 0.035311583429574966,
      "pose_mae_dy": 0.03555941954255104,
      "pose_rmse_dtheta": 0.21347863972187042,
      "pose_rmse_dx": 0.09642886370420456,
      "pose_rmse_dy": 0.07895111292600632,
      "pose_rmse_mean": 0.1296195387840271,
      "rmse_dtheta": 0.024526502937078476,
      "rmse_dx": 0.00899012666195631,
      "rmse_dy": 0.007890244945883751,
      "rmse_mean": 0.013802292756736279,
      "rotation_flip": 0.0052505964413285255,
      "sparse_tokens": 32057.0,
      "step": 181,
      "turn_loss": 0.10631478577852249,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.008455677383385988,
      "grad_norm": 0.8139479756355286,
      "learning_rate": 9.999349485284383e-06,
      "loss": 0.2383,
      "mae_dtheta": 0.032659292221069336,
      "mae_dx": 0.011969761922955513,
      "mae_dy": 0.003086312673985958,
      "pose_mae_dtheta": 0.25413644313812256,
      "pose_mae_dx": 0.08483586460351944,
      "pose_mae_dy": 0.04064243286848068,
      "pose_rmse_dtheta": 0.40384846925735474,
      "pose_rmse_dx": 0.20984899997711182,
      "pose_rmse_dy": 0.10216734558343887,
      "pose_rmse_mean": 0.23862162232398987,
      "rmse_dtheta": 0.04770515486598015,
      "rmse_dx": 0.02452542446553707,
      "rmse_dy": 0.006486374419182539,
      "rmse_mean": 0.026238983497023582,
      "rotation_flip": 0.0072115384973585606,
      "sparse_tokens": 7741.0,
      "step": 182,
      "turn_loss": 0.24503876268863678,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.008502137149228768,
      "grad_norm": 0.5068347454071045,
      "learning_rate": 9.999327982592195e-06,
      "loss": 0.2082,
      "mae_dtheta": 0.049650561064481735,
      "mae_dx": 0.011926320381462574,
      "mae_dy": 0.007982736453413963,
      "pose_mae_dtheta": 0.41309598088264465,
      "pose_mae_dx": 0.10220053791999817,
      "pose_mae_dy": 0.07979387044906616,
      "pose_rmse_dtheta": 0.6723036170005798,
      "pose_rmse_dx": 0.20720289647579193,
      "pose_rmse_dy": 0.18720325827598572,
      "pose_rmse_mean": 0.3555699288845062,
      "rmse_dtheta": 0.06833081692457199,
      "rmse_dx": 0.022767601534724236,
      "rmse_dy": 0.017309701070189476,
      "rmse_mean": 0.036136042326688766,
      "rotation_flip": 0.01673101633787155,
      "sparse_tokens": 11506.0,
      "step": 183,
      "turn_loss": 0.44848641753196716,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.008548596915071548,
      "grad_norm": 0.5135450959205627,
      "learning_rate": 9.999306130294317e-06,
      "loss": 0.1053,
      "mae_dtheta": 0.011494669131934643,
      "mae_dx": 0.0026495694182813168,
      "mae_dy": 0.0026895254850387573,
      "pose_mae_dtheta": 0.07800237089395523,
      "pose_mae_dx": 0.03123542107641697,
      "pose_mae_dy": 0.031449925154447556,
      "pose_rmse_dtheta": 0.1943325251340866,
      "pose_rmse_dx": 0.08282133936882019,
      "pose_rmse_dy": 0.07539493590593338,
      "pose_rmse_mean": 0.11751626431941986,
      "rmse_dtheta": 0.024762598797678947,
      "rmse_dx": 0.008333963342010975,
      "rmse_dy": 0.005751339718699455,
      "rmse_mean": 0.012949300929903984,
      "rotation_flip": 0.006459948141127825,
      "sparse_tokens": 32073.0,
      "step": 184,
      "turn_loss": 0.09330427646636963,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.008595056680914329,
      "grad_norm": 0.5573525428771973,
      "learning_rate": 9.99928392839228e-06,
      "loss": 0.1476,
      "mae_dtheta": 0.03579733520746231,
      "mae_dx": 0.0171724371612072,
      "mae_dy": 0.007984471507370472,
      "pose_mae_dtheta": 0.2875436544418335,
      "pose_mae_dx": 0.13659490644931793,
      "pose_mae_dy": 0.07543057203292847,
      "pose_rmse_dtheta": 0.48019668459892273,
      "pose_rmse_dx": 0.2850520610809326,
      "pose_rmse_dy": 0.17155210673809052,
      "pose_rmse_mean": 0.3122669756412506,
      "rmse_dtheta": 0.053209614008665085,
      "rmse_dx": 0.030434075742959976,
      "rmse_dy": 0.017801007255911827,
      "rmse_mean": 0.03381489962339401,
      "rotation_flip": 0.014154870994389057,
      "sparse_tokens": 20114.0,
      "step": 185,
      "turn_loss": 0.3430421054363251,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.008641516446757109,
      "grad_norm": 0.7123764753341675,
      "learning_rate": 9.999261376887634e-06,
      "loss": 0.1899,
      "mae_dtheta": 0.03690297156572342,
      "mae_dx": 0.01394413411617279,
      "mae_dy": 0.005014937371015549,
      "pose_mae_dtheta": 0.30470478534698486,
      "pose_mae_dx": 0.13052017986774445,
      "pose_mae_dy": 0.06867367774248123,
      "pose_rmse_dtheta": 0.4727587401866913,
      "pose_rmse_dx": 0.2738334834575653,
      "pose_rmse_dy": 0.14725825190544128,
      "pose_rmse_mean": 0.2979501485824585,
      "rmse_dtheta": 0.050502628087997437,
      "rmse_dx": 0.027119997888803482,
      "rmse_dy": 0.009455606341362,
      "rmse_mean": 0.029026076197624207,
      "rotation_flip": 0.02773246355354786,
      "sparse_tokens": 11124.0,
      "step": 186,
      "turn_loss": 0.23962624371051788,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.008687976212599889,
      "grad_norm": 0.8488062024116516,
      "learning_rate": 9.999238475781957e-06,
      "loss": 0.2431,
      "mae_dtheta": 0.01648065634071827,
      "mae_dx": 0.004408037755638361,
      "mae_dy": 0.006419400684535503,
      "pose_mae_dtheta": 0.12215700000524521,
      "pose_mae_dx": 0.06363197416067123,
      "pose_mae_dy": 0.05650549381971359,
      "pose_rmse_dtheta": 0.2571733891963959,
      "pose_rmse_dx": 0.1534768044948578,
      "pose_rmse_dy": 0.12702316045761108,
      "pose_rmse_mean": 0.17922446131706238,
      "rmse_dtheta": 0.030253678560256958,
      "rmse_dx": 0.010328286327421665,
      "rmse_dy": 0.012344096787273884,
      "rmse_mean": 0.01764202117919922,
      "rotation_flip": 0.01118789054453373,
      "sparse_tokens": 32105.0,
      "step": 187,
      "turn_loss": 0.17573527991771698,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.00873443597844267,
      "grad_norm": 0.4623841643333435,
      "learning_rate": 9.999215225076851e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.012959592044353485,
      "mae_dx": 0.003277756040915847,
      "mae_dy": 0.004268763121217489,
      "pose_mae_dtheta": 0.08558787405490875,
      "pose_mae_dx": 0.049220774322748184,
      "pose_mae_dy": 0.043738361448049545,
      "pose_rmse_dtheta": 0.14764420688152313,
      "pose_rmse_dx": 0.10799505561590195,
      "pose_rmse_dy": 0.09074980020523071,
      "pose_rmse_mean": 0.1154630184173584,
      "rmse_dtheta": 0.023095067590475082,
      "rmse_dx": 0.007196280639618635,
      "rmse_dy": 0.008607394061982632,
      "rmse_mean": 0.012966248206794262,
      "rotation_flip": 0.008426121436059475,
      "sparse_tokens": 32185.0,
      "step": 188,
      "turn_loss": 0.11432459950447083,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.00878089574428545,
      "grad_norm": 0.6609416604042053,
      "learning_rate": 9.999191624773939e-06,
      "loss": 0.1138,
      "mae_dtheta": 0.00949929840862751,
      "mae_dx": 0.0020798633340746164,
      "mae_dy": 0.0020053198095411062,
      "pose_mae_dtheta": 0.06717201322317123,
      "pose_mae_dx": 0.02250942401587963,
      "pose_mae_dy": 0.028513286262750626,
      "pose_rmse_dtheta": 0.1531030386686325,
      "pose_rmse_dx": 0.05870569124817848,
      "pose_rmse_dy": 0.06721661984920502,
      "pose_rmse_mean": 0.09300845116376877,
      "rmse_dtheta": 0.020320236682891846,
      "rmse_dx": 0.006492206361144781,
      "rmse_dy": 0.004194624722003937,
      "rmse_mean": 0.010335689410567284,
      "rotation_flip": 0.0028420626185834408,
      "sparse_tokens": 32121.0,
      "step": 189,
      "turn_loss": 0.07286756485700607,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.008827355510128228,
      "grad_norm": 1.1152617931365967,
      "learning_rate": 9.999167674874875e-06,
      "loss": 0.2305,
      "mae_dtheta": 0.007137778680771589,
      "mae_dx": 0.0015569546958431602,
      "mae_dy": 0.001425543799996376,
      "pose_mae_dtheta": 0.05176762491464615,
      "pose_mae_dx": 0.019058912992477417,
      "pose_mae_dy": 0.023156732320785522,
      "pose_rmse_dtheta": 0.11703820526599884,
      "pose_rmse_dx": 0.05126390978693962,
      "pose_rmse_dy": 0.05903320759534836,
      "pose_rmse_mean": 0.07577844709157944,
      "rmse_dtheta": 0.015029087662696838,
      "rmse_dx": 0.005130481906235218,
      "rmse_dy": 0.0029409348499029875,
      "rmse_mean": 0.0077001675963401794,
      "rotation_flip": 0.0018306636484339833,
      "sparse_tokens": 32105.0,
      "step": 190,
      "turn_loss": 0.05376250296831131,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5547.0,
      "epoch": 0.008873815275971008,
      "grad_norm": 0.6203436851501465,
      "learning_rate": 9.999143375381331e-06,
      "loss": 0.1453,
      "mae_dtheta": 0.020250093191862106,
      "mae_dx": 0.0035103627014905214,
      "mae_dy": 0.0053396327421069145,
      "pose_mae_dtheta": 0.1680167317390442,
      "pose_mae_dx": 0.04700975865125656,
      "pose_mae_dy": 0.08732020109891891,
      "pose_rmse_dtheta": 0.29877370595932007,
      "pose_rmse_dx": 0.11065617948770523,
      "pose_rmse_dy": 0.2036931812763214,
      "pose_rmse_mean": 0.20437435805797577,
      "rmse_dtheta": 0.033925287425518036,
      "rmse_dx": 0.009932984597980976,
      "rmse_dy": 0.010653115808963776,
      "rmse_mean": 0.018170462921261787,
      "rotation_flip": 0.017094017937779427,
      "sparse_tokens": 4636.0,
      "step": 191,
      "turn_loss": 0.2106943279504776,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 15591.0,
      "epoch": 0.008920275041813789,
      "grad_norm": 0.8212928771972656,
      "learning_rate": 9.999118726295007e-06,
      "loss": 0.1347,
      "mae_dtheta": 0.03229093551635742,
      "mae_dx": 0.009415466338396072,
      "mae_dy": 0.00727427750825882,
      "pose_mae_dtheta": 0.24508939683437347,
      "pose_mae_dx": 0.0944855809211731,
      "pose_mae_dy": 0.08615714311599731,
      "pose_rmse_dtheta": 0.4543399214744568,
      "pose_rmse_dx": 0.21223801374435425,
      "pose_rmse_dy": 0.195424422621727,
      "pose_rmse_mean": 0.287334144115448,
      "rmse_dtheta": 0.05173309147357941,
      "rmse_dx": 0.020266838371753693,
      "rmse_dy": 0.014710640534758568,
      "rmse_mean": 0.028903525322675705,
      "rotation_flip": 0.010973936878144741,
      "sparse_tokens": 12312.0,
      "step": 192,
      "turn_loss": 0.3174286186695099,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.008966734807656569,
      "grad_norm": 0.9641065001487732,
      "learning_rate": 9.99909372761763e-06,
      "loss": 0.2383,
      "mae_dtheta": 0.016896510496735573,
      "mae_dx": 0.003978452645242214,
      "mae_dy": 0.005245516076683998,
      "pose_mae_dtheta": 0.1164453998208046,
      "pose_mae_dx": 0.05457821115851402,
      "pose_mae_dy": 0.05778875946998596,
      "pose_rmse_dtheta": 0.22028659284114838,
      "pose_rmse_dx": 0.11670757085084915,
      "pose_rmse_dy": 0.11148061603307724,
      "pose_rmse_mean": 0.14949160814285278,
      "rmse_dtheta": 0.02949386090040207,
      "rmse_dx": 0.010157821699976921,
      "rmse_dy": 0.009708245284855366,
      "rmse_mean": 0.01645331084728241,
      "rotation_flip": 0.006709157954901457,
      "sparse_tokens": 32089.0,
      "step": 193,
      "turn_loss": 0.16983920335769653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.009013194573499349,
      "grad_norm": 0.6481682658195496,
      "learning_rate": 9.999068379350944e-06,
      "loss": 0.1506,
      "mae_dtheta": 0.03487128019332886,
      "mae_dx": 0.009649430401623249,
      "mae_dy": 0.004748377948999405,
      "pose_mae_dtheta": 0.2818882465362549,
      "pose_mae_dx": 0.07957480102777481,
      "pose_mae_dy": 0.04999883472919464,
      "pose_rmse_dtheta": 0.507880687713623,
      "pose_rmse_dx": 0.1980869174003601,
      "pose_rmse_dy": 0.1168409064412117,
      "pose_rmse_mean": 0.2742695212364197,
      "rmse_dtheta": 0.055009596049785614,
      "rmse_dx": 0.021782491356134415,
      "rmse_dy": 0.010373126715421677,
      "rmse_mean": 0.029055073857307434,
      "rotation_flip": 0.014367816038429737,
      "sparse_tokens": 6052.0,
      "step": 194,
      "turn_loss": 0.26174071431159973,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.00905965433934213,
      "grad_norm": 0.6352063417434692,
      "learning_rate": 9.999042681496723e-06,
      "loss": 0.1676,
      "mae_dtheta": 0.040915388613939285,
      "mae_dx": 0.017059486359357834,
      "mae_dy": 0.005193780642002821,
      "pose_mae_dtheta": 0.3104252517223358,
      "pose_mae_dx": 0.12611651420593262,
      "pose_mae_dy": 0.07574481517076492,
      "pose_rmse_dtheta": 0.5247725248336792,
      "pose_rmse_dx": 0.2459433525800705,
      "pose_rmse_dy": 0.17286954820156097,
      "pose_rmse_mean": 0.3145284950733185,
      "rmse_dtheta": 0.05836489424109459,
      "rmse_dx": 0.029275234788656235,
      "rmse_dy": 0.01055216509848833,
      "rmse_mean": 0.032730765640735626,
      "rotation_flip": 0.009845288470387459,
      "sparse_tokens": 12358.0,
      "step": 195,
      "turn_loss": 0.28611648082733154,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.00910611410518491,
      "grad_norm": 0.5284495949745178,
      "learning_rate": 9.999016634056764e-06,
      "loss": 0.1476,
      "mae_dtheta": 0.012384808622300625,
      "mae_dx": 0.002655446995049715,
      "mae_dy": 0.00272951927036047,
      "pose_mae_dtheta": 0.08310902118682861,
      "pose_mae_dx": 0.033274345099925995,
      "pose_mae_dy": 0.030326806008815765,
      "pose_rmse_dtheta": 0.16302573680877686,
      "pose_rmse_dx": 0.08370242267847061,
      "pose_rmse_dy": 0.06653855741024017,
      "pose_rmse_mean": 0.10442223399877548,
      "rmse_dtheta": 0.023279933258891106,
      "rmse_dx": 0.008143397979438305,
      "rmse_dy": 0.0055332002229988575,
      "rmse_mean": 0.012318843975663185,
      "rotation_flip": 0.0038822386413812637,
      "sparse_tokens": 32153.0,
      "step": 196,
      "turn_loss": 0.11203014850616455,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.00915257387102769,
      "grad_norm": 0.5803030133247375,
      "learning_rate": 9.998990237032888e-06,
      "loss": 0.1232,
      "mae_dtheta": 0.006438036914914846,
      "mae_dx": 0.0017961161211133003,
      "mae_dy": 0.0010714929085224867,
      "pose_mae_dtheta": 0.04682432860136032,
      "pose_mae_dx": 0.01591934636235237,
      "pose_mae_dy": 0.014945311471819878,
      "pose_rmse_dtheta": 0.133422389626503,
      "pose_rmse_dx": 0.045473504811525345,
      "pose_rmse_dy": 0.03624902293086052,
      "pose_rmse_mean": 0.07171497493982315,
      "rmse_dtheta": 0.019143708050251007,
      "rmse_dx": 0.005936319008469582,
      "rmse_dy": 0.0024790039751678705,
      "rmse_mean": 0.009186344221234322,
      "rotation_flip": 0.005897772032767534,
      "sparse_tokens": 32089.0,
      "step": 197,
      "turn_loss": 0.05713198706507683,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.00919903363687047,
      "grad_norm": 0.4935750365257263,
      "learning_rate": 9.998963490426943e-06,
      "loss": 0.1236,
      "mae_dtheta": 0.010961095802485943,
      "mae_dx": 0.0021118945442140102,
      "mae_dy": 0.0032000478822737932,
      "pose_mae_dtheta": 0.08335065096616745,
      "pose_mae_dx": 0.03487756848335266,
      "pose_mae_dy": 0.04490731284022331,
      "pose_rmse_dtheta": 0.16872672736644745,
      "pose_rmse_dx": 0.08020032942295074,
      "pose_rmse_dy": 0.09841424971818924,
      "pose_rmse_mean": 0.11578043550252914,
      "rmse_dtheta": 0.02134433388710022,
      "rmse_dx": 0.005848268512636423,
      "rmse_dy": 0.006857411935925484,
      "rmse_mean": 0.011350004933774471,
      "rotation_flip": 0.007686932105571032,
      "sparse_tokens": 32105.0,
      "step": 198,
      "turn_loss": 0.0887419804930687,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.00924549340271325,
      "grad_norm": 0.7574471235275269,
      "learning_rate": 9.998936394240798e-06,
      "loss": 0.226,
      "mae_dtheta": 0.016939517110586166,
      "mae_dx": 0.00421195849776268,
      "mae_dy": 0.004758496303111315,
      "pose_mae_dtheta": 0.11721115559339523,
      "pose_mae_dx": 0.04827159643173218,
      "pose_mae_dy": 0.04567117989063263,
      "pose_rmse_dtheta": 0.2411881536245346,
      "pose_rmse_dx": 0.1267331838607788,
      "pose_rmse_dy": 0.0873035117983818,
      "pose_rmse_mean": 0.151741623878479,
      "rmse_dtheta": 0.03063815087080002,
      "rmse_dx": 0.012170963920652866,
      "rmse_dy": 0.010150967165827751,
      "rmse_mean": 0.017653360962867737,
      "rotation_flip": 0.007823129184544086,
      "sparse_tokens": 32089.0,
      "step": 199,
      "turn_loss": 0.16112086176872253,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23618.0,
      "epoch": 0.00929195316855603,
      "grad_norm": 0.6130401492118835,
      "learning_rate": 9.998908948476348e-06,
      "loss": 0.1899,
      "mae_dtheta": 0.0436781607568264,
      "mae_dx": 0.015250067226588726,
      "mae_dy": 0.006140788551419973,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6130401492118835,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 113.12994384765625,
      "model/head/act_norm_mean": 83.22516454409246,
      "model/head/act_norm_min": 58.9566535949707,
      "model/head/act_over_embed": 57.19311224096677,
      "model/head/grad_frac": 0.1301419883966446,
      "model/head/grad_norm": 0.07978226244449615,
      "model/head/grad_zero_frac": 0.00012151508417446166,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6845970676369864,
      "model/head/update_ratio": 0.0013983654789626598,
      "model/head/weight_delta": 1.5689022541046143,
      "model/head/weight_delta_rel": 0.027523193508386612,
      "model/head/weight_norm": 57.0539436340332,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.408879816532135,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.408879816532135,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.408879816532135,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2809860379140366,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06554356962442398,
      "model/modality_embedder.encoders.pose/grad_norm": 0.040180839598178864,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013124074321240187,
      "model/modality_embedder.encoders.pose/weight_delta": 0.4487582743167877,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.014662331901490688,
      "model/modality_embedder.encoders.pose/weight_norm": 30.616132736206055,
      "model/modality_embedder/grad_frac": 0.06554356962442398,
      "model/modality_embedder/grad_norm": 0.040180839598178864,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0013124074321240187,
      "model/modality_embedder/weight_delta": 0.4487582743167877,
      "model/modality_embedder/weight_delta_rel": 0.014662331901490688,
      "model/modality_embedder/weight_norm": 30.616132736206055,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 64.74127197265625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 20.602527383670363,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.125938415527344,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.158249701958574,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0986856073141098,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06049823760986328,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002203729934990406,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.18990957736968994,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.006920419633388519,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.452653884887695,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 66.33830261230469,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 21.500122309197653,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.64573860168457,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 14.77508533819702,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10068877786397934,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06172626465559006,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002136548049747944,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.20169009268283844,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.00698670232668519,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.890649795532227,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 67.84021759033203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 23.216398945422917,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.01010799407959,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 15.954526710646045,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10339998453855515,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06338834017515182,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0021267179399728775,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.1973074972629547,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.006625216454267502,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.80571174621582,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 68.5147476196289,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 25.330384322678842,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.794005393981934,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 17.407277253339238,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10334794968366623,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0633564442396164,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002163799712434411,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.16966299712657928,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.005798276048153639,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.28017807006836,
      "model/normalizer/grad_frac": 0.34292468428611755,
      "model/normalizer/grad_norm": 0.21022659540176392,
      "model/normalizer/grad_zero_frac": 0.0001772607647581026,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002706713043153286,
      "model/normalizer/weight_delta": 0.3926525413990021,
      "model/normalizer/weight_delta_rel": 0.005057137459516525,
      "model/normalizer/weight_norm": 77.66859436035156,
      "pose_mae_dtheta": 0.37868940830230713,
      "pose_mae_dx": 0.12327773869037628,
      "pose_mae_dy": 0.0706908106803894,
      "pose_rmse_dtheta": 0.5695862174034119,
      "pose_rmse_dx": 0.2628166079521179,
      "pose_rmse_dy": 0.1461893618106842,
      "pose_rmse_mean": 0.32619738578796387,
      "rmse_dtheta": 0.05978136509656906,
      "rmse_dx": 0.02816690504550934,
      "rmse_dy": 0.01188108790665865,
      "rmse_mean": 0.033276453614234924,
      "rotation_flip": 0.014795474708080292,
      "sparse_tokens": 18176.0,
      "step": 200,
      "turn_loss": 0.35319817066192627,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "epoch": 0.00929195316855603,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.34307676553726196,
      "eval_objectnav_nopose_mae_dtheta": 0.04494613781571388,
      "eval_objectnav_nopose_mae_dx": 0.015643682330846786,
      "eval_objectnav_nopose_mae_dy": 0.005531627684831619,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3758459985256195,
      "eval_objectnav_nopose_pose_mae_dx": 0.129463329911232,
      "eval_objectnav_nopose_pose_mae_dy": 0.06550320982933044,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.6055237650871277,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2671554684638977,
      "eval_objectnav_nopose_pose_rmse_dy": 0.15078461170196533,
      "eval_objectnav_nopose_pose_rmse_mean": 0.34115463495254517,
      "eval_objectnav_nopose_rmse_dtheta": 0.06255222856998444,
      "eval_objectnav_nopose_rmse_dx": 0.02876727655529976,
      "eval_objectnav_nopose_rmse_dy": 0.010933940298855305,
      "eval_objectnav_nopose_rmse_mean": 0.03408448398113251,
      "eval_objectnav_nopose_rotation_flip": 0.012652019970119,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.34307676553726196,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 200
    },
    {
      "epoch": 0.00929195316855603,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2946392893791199,
      "eval_objectnav_pose_mae_dtheta": 0.03863602504134178,
      "eval_objectnav_pose_mae_dx": 0.012549392879009247,
      "eval_objectnav_pose_mae_dy": 0.005120143759995699,
      "eval_objectnav_pose_pose_mae_dtheta": 0.3010443150997162,
      "eval_objectnav_pose_pose_mae_dx": 0.10121160000562668,
      "eval_objectnav_pose_pose_mae_dy": 0.055479004979133606,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5145322680473328,
      "eval_objectnav_pose_pose_rmse_dx": 0.2274143099784851,
      "eval_objectnav_pose_pose_rmse_dy": 0.1350610852241516,
      "eval_objectnav_pose_pose_rmse_mean": 0.2923358976840973,
      "eval_objectnav_pose_rmse_dtheta": 0.05628788471221924,
      "eval_objectnav_pose_rmse_dx": 0.025179898366332054,
      "eval_objectnav_pose_rmse_dy": 0.01062806323170662,
      "eval_objectnav_pose_rmse_mean": 0.030698617920279503,
      "eval_objectnav_pose_rotation_flip": 0.01402198150753975,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2946392893791199,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 200
    },
    {
      "epoch": 0.00929195316855603,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.11647271364927292,
      "eval_pointnav_mae_dtheta": 0.013536524958908558,
      "eval_pointnav_mae_dx": 0.0035255716647952795,
      "eval_pointnav_mae_dy": 0.0030922177247703075,
      "eval_pointnav_pose_mae_dtheta": 0.0979439914226532,
      "eval_pointnav_pose_mae_dx": 0.038974326103925705,
      "eval_pointnav_pose_mae_dy": 0.03647463768720627,
      "eval_pointnav_pose_rmse_dtheta": 0.24300508201122284,
      "eval_pointnav_pose_rmse_dx": 0.10566270351409912,
      "eval_pointnav_pose_rmse_dy": 0.10483070462942123,
      "eval_pointnav_pose_rmse_mean": 0.151166170835495,
      "eval_pointnav_rmse_dtheta": 0.02936876378953457,
      "eval_pointnav_rmse_dx": 0.009958726353943348,
      "eval_pointnav_rmse_dy": 0.008162551559507847,
      "eval_pointnav_rmse_mean": 0.015830013900995255,
      "eval_pointnav_rotation_flip": 0.005949422717094421,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.11647271364927292,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 200
    },
    {
      "epoch": 0.00929195316855603,
      "eval_loss": 0.2513962561885516,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.34307676553726196,
      "eval_objectnav_nopose_mae_dtheta": 0.04494613781571388,
      "eval_objectnav_nopose_mae_dx": 0.015643682330846786,
      "eval_objectnav_nopose_mae_dy": 0.005531627684831619,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3758459985256195,
      "eval_objectnav_nopose_pose_mae_dx": 0.129463329911232,
      "eval_objectnav_nopose_pose_mae_dy": 0.06550320982933044,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.6055237650871277,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2671554684638977,
      "eval_objectnav_nopose_pose_rmse_dy": 0.15078461170196533,
      "eval_objectnav_nopose_pose_rmse_mean": 0.34115463495254517,
      "eval_objectnav_nopose_rmse_dtheta": 0.06255222856998444,
      "eval_objectnav_nopose_rmse_dx": 0.02876727655529976,
      "eval_objectnav_nopose_rmse_dy": 0.010933940298855305,
      "eval_objectnav_nopose_rmse_mean": 0.03408448398113251,
      "eval_objectnav_nopose_rotation_flip": 0.012652019970119,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.34307676553726196,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2946392893791199,
      "eval_objectnav_pose_mae_dtheta": 0.03863602504134178,
      "eval_objectnav_pose_mae_dx": 0.012549392879009247,
      "eval_objectnav_pose_mae_dy": 0.005120143759995699,
      "eval_objectnav_pose_pose_mae_dtheta": 0.3010443150997162,
      "eval_objectnav_pose_pose_mae_dx": 0.10121160000562668,
      "eval_objectnav_pose_pose_mae_dy": 0.055479004979133606,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5145322680473328,
      "eval_objectnav_pose_pose_rmse_dx": 0.2274143099784851,
      "eval_objectnav_pose_pose_rmse_dy": 0.1350610852241516,
      "eval_objectnav_pose_pose_rmse_mean": 0.2923358976840973,
      "eval_objectnav_pose_rmse_dtheta": 0.05628788471221924,
      "eval_objectnav_pose_rmse_dx": 0.025179898366332054,
      "eval_objectnav_pose_rmse_dy": 0.01062806323170662,
      "eval_objectnav_pose_rmse_mean": 0.030698617920279503,
      "eval_objectnav_pose_rotation_flip": 0.01402198150753975,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2946392893791199,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.11647271364927292,
      "eval_pointnav_mae_dtheta": 0.013536524958908558,
      "eval_pointnav_mae_dx": 0.0035255716647952795,
      "eval_pointnav_mae_dy": 0.0030922177247703075,
      "eval_pointnav_pose_mae_dtheta": 0.0979439914226532,
      "eval_pointnav_pose_mae_dx": 0.038974326103925705,
      "eval_pointnav_pose_mae_dy": 0.03647463768720627,
      "eval_pointnav_pose_rmse_dtheta": 0.24300508201122284,
      "eval_pointnav_pose_rmse_dx": 0.10566270351409912,
      "eval_pointnav_pose_rmse_dy": 0.10483070462942123,
      "eval_pointnav_pose_rmse_mean": 0.151166170835495,
      "eval_pointnav_rmse_dtheta": 0.02936876378953457,
      "eval_pointnav_rmse_dx": 0.009958726353943348,
      "eval_pointnav_rmse_dy": 0.008162551559507847,
      "eval_pointnav_rmse_mean": 0.015830013900995255,
      "eval_pointnav_rotation_flip": 0.005949422717094421,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.11647271364927292,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 200
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.00933841293439881,
      "grad_norm": 0.5630971789360046,
      "learning_rate": 9.99888115313551e-06,
      "loss": 0.2059,
      "mae_dtheta": 0.03701905906200409,
      "mae_dx": 0.013792860321700573,
      "mae_dy": 0.007203718647360802,
      "pose_mae_dtheta": 0.2949362099170685,
      "pose_mae_dx": 0.10216669738292694,
      "pose_mae_dy": 0.07754649221897125,
      "pose_rmse_dtheta": 0.5076771378517151,
      "pose_rmse_dx": 0.2206488400697708,
      "pose_rmse_dy": 0.19424089789390564,
      "pose_rmse_mean": 0.3075222969055176,
      "rmse_dtheta": 0.05521902069449425,
      "rmse_dx": 0.026585116982460022,
      "rmse_dy": 0.014537486247718334,
      "rmse_mean": 0.032113876193761826,
      "rotation_flip": 0.021574972197413445,
      "sparse_tokens": 14697.0,
      "step": 201,
      "turn_loss": 0.3179231882095337,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.009384872700241591,
      "grad_norm": 0.6406707167625427,
      "learning_rate": 9.998853008220231e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.029274966567754745,
      "mae_dx": 0.012854157015681267,
      "mae_dy": 0.010197678580880165,
      "pose_mae_dtheta": 0.24961140751838684,
      "pose_mae_dx": 0.14732690155506134,
      "pose_mae_dy": 0.13051801919937134,
      "pose_rmse_dtheta": 0.4942872226238251,
      "pose_rmse_dx": 0.31352952122688293,
      "pose_rmse_dy": 0.2677782475948334,
      "pose_rmse_mean": 0.3585316836833954,
      "rmse_dtheta": 0.04890797659754753,
      "rmse_dx": 0.028073711320757866,
      "rmse_dy": 0.019573312252759933,
      "rmse_mean": 0.03218499943614006,
      "rotation_flip": 0.013559321872889996,
      "sparse_tokens": 6936.0,
      "step": 202,
      "turn_loss": 0.3347571790218353,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.009431332466084371,
      "grad_norm": 0.496571809053421,
      "learning_rate": 9.99882451373248e-06,
      "loss": 0.0956,
      "mae_dtheta": 0.013149690814316273,
      "mae_dx": 0.0030718485359102488,
      "mae_dy": 0.0033249412663280964,
      "pose_mae_dtheta": 0.09123475104570389,
      "pose_mae_dx": 0.03150442615151405,
      "pose_mae_dy": 0.03459983319044113,
      "pose_rmse_dtheta": 0.18185126781463623,
      "pose_rmse_dx": 0.07702220231294632,
      "pose_rmse_dy": 0.0731598362326622,
      "pose_rmse_mean": 0.11067777127027512,
      "rmse_dtheta": 0.02505902200937271,
      "rmse_dx": 0.00856243260204792,
      "rmse_dy": 0.007052925415337086,
      "rmse_mean": 0.01355812605470419,
      "rotation_flip": 0.004442798905074596,
      "sparse_tokens": 32137.0,
      "step": 203,
      "turn_loss": 0.12031269818544388,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30724.0,
      "epoch": 0.009477792231927152,
      "grad_norm": 0.5724807977676392,
      "learning_rate": 9.998795669674244e-06,
      "loss": 0.2152,
      "mae_dtheta": 0.032463110983371735,
      "mae_dx": 0.016478080302476883,
      "mae_dy": 0.004811775870621204,
      "pose_mae_dtheta": 0.28115931153297424,
      "pose_mae_dx": 0.13857094943523407,
      "pose_mae_dy": 0.06469035893678665,
      "pose_rmse_dtheta": 0.507922351360321,
      "pose_rmse_dx": 0.2764297127723694,
      "pose_rmse_dy": 0.15870912373065948,
      "pose_rmse_mean": 0.31435373425483704,
      "rmse_dtheta": 0.05079018697142601,
      "rmse_dx": 0.029747141525149345,
      "rmse_dy": 0.008807720616459846,
      "rmse_mean": 0.029781682416796684,
      "rotation_flip": 0.009345794096589088,
      "sparse_tokens": 24856.0,
      "step": 204,
      "turn_loss": 0.24582399427890778,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.009524251997769932,
      "grad_norm": 0.5437278747558594,
      "learning_rate": 9.998766476047546e-06,
      "loss": 0.1709,
      "mae_dtheta": 0.027513455599546432,
      "mae_dx": 0.019742080941796303,
      "mae_dy": 0.004245247226208448,
      "pose_mae_dtheta": 0.21975411474704742,
      "pose_mae_dx": 0.15609213709831238,
      "pose_mae_dy": 0.0592021644115448,
      "pose_rmse_dtheta": 0.4147859513759613,
      "pose_rmse_dx": 0.28760427236557007,
      "pose_rmse_dy": 0.11859201639890671,
      "pose_rmse_mean": 0.2736607491970062,
      "rmse_dtheta": 0.04332637041807175,
      "rmse_dx": 0.03213248401880264,
      "rmse_dy": 0.006881461013108492,
      "rmse_mean": 0.027446772903203964,
      "rotation_flip": 0.007407407276332378,
      "sparse_tokens": 8124.0,
      "step": 205,
      "turn_loss": 0.2548989951610565,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.009570711763612712,
      "grad_norm": 1.20600163936615,
      "learning_rate": 9.998736932854425e-06,
      "loss": 0.3258,
      "mae_dtheta": 0.04643905907869339,
      "mae_dx": 0.01752917654812336,
      "mae_dy": 0.007254490163177252,
      "pose_mae_dtheta": 0.3682183027267456,
      "pose_mae_dx": 0.128313809633255,
      "pose_mae_dy": 0.08158659934997559,
      "pose_rmse_dtheta": 0.5474967956542969,
      "pose_rmse_dx": 0.26848307251930237,
      "pose_rmse_dy": 0.1599496304988861,
      "pose_rmse_mean": 0.3253098428249359,
      "rmse_dtheta": 0.060740355402231216,
      "rmse_dx": 0.030577728524804115,
      "rmse_dy": 0.013156461529433727,
      "rmse_mean": 0.03482484817504883,
      "rotation_flip": 0.014577259309589863,
      "sparse_tokens": 11928.0,
      "step": 206,
      "turn_loss": 0.403408020734787,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 12027.0,
      "epoch": 0.009617171529455492,
      "grad_norm": 1.1350799798965454,
      "learning_rate": 9.99870704009695e-06,
      "loss": 0.2995,
      "mae_dtheta": 0.03268852457404137,
      "mae_dx": 0.01139002200216055,
      "mae_dy": 0.006478798110038042,
      "pose_mae_dtheta": 0.2468215972185135,
      "pose_mae_dx": 0.09457096457481384,
      "pose_mae_dy": 0.08773883432149887,
      "pose_rmse_dtheta": 0.41736388206481934,
      "pose_rmse_dx": 0.20338143408298492,
      "pose_rmse_dy": 0.19426731765270233,
      "pose_rmse_mean": 0.2716708779335022,
      "rmse_dtheta": 0.04947672411799431,
      "rmse_dx": 0.024284284561872482,
      "rmse_dy": 0.013402977026998997,
      "rmse_mean": 0.029054662212729454,
      "rotation_flip": 0.016949152573943138,
      "sparse_tokens": 9800.0,
      "step": 207,
      "turn_loss": 0.2701341211795807,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.00966363129529827,
      "grad_norm": 0.9483124017715454,
      "learning_rate": 9.998676797777204e-06,
      "loss": 0.1741,
      "mae_dtheta": 0.014009080827236176,
      "mae_dx": 0.004221486393362284,
      "mae_dy": 0.004526905249804258,
      "pose_mae_dtheta": 0.09887737035751343,
      "pose_mae_dx": 0.057852521538734436,
      "pose_mae_dy": 0.04504295438528061,
      "pose_rmse_dtheta": 0.19865745306015015,
      "pose_rmse_dx": 0.1468023806810379,
      "pose_rmse_dy": 0.1028805822134018,
      "pose_rmse_mean": 0.14944681525230408,
      "rmse_dtheta": 0.026300380006432533,
      "rmse_dx": 0.010507709346711636,
      "rmse_dy": 0.010489800944924355,
      "rmse_mean": 0.01576596312224865,
      "rotation_flip": 0.008994915522634983,
      "sparse_tokens": 32121.0,
      "step": 208,
      "turn_loss": 0.146100252866745,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.009710091061141051,
      "grad_norm": 0.9977567195892334,
      "learning_rate": 9.99864620589731e-06,
      "loss": 0.1388,
      "mae_dtheta": 0.017930999398231506,
      "mae_dx": 0.002326437272131443,
      "mae_dy": 0.004414684604853392,
      "pose_mae_dtheta": 0.12633518874645233,
      "pose_mae_dx": 0.04120846092700958,
      "pose_mae_dy": 0.0573093555867672,
      "pose_rmse_dtheta": 0.2903447449207306,
      "pose_rmse_dx": 0.09848491847515106,
      "pose_rmse_dy": 0.16213196516036987,
      "pose_rmse_mean": 0.18365387618541718,
      "rmse_dtheta": 0.03451431170105934,
      "rmse_dx": 0.006168024614453316,
      "rmse_dy": 0.009679687209427357,
      "rmse_mean": 0.016787342727184296,
      "rotation_flip": 0.00626304792240262,
      "sparse_tokens": 32089.0,
      "step": 209,
      "turn_loss": 0.15762017667293549,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1980.0,
      "epoch": 0.009756550826983831,
      "grad_norm": 1.1499367952346802,
      "learning_rate": 9.9986152644594e-06,
      "loss": 0.1347,
      "mae_dtheta": 0.027345506474375725,
      "mae_dx": 0.022708667442202568,
      "mae_dy": 0.005268906243145466,
      "pose_mae_dtheta": 0.20458632707595825,
      "pose_mae_dx": 0.15920542180538177,
      "pose_mae_dy": 0.0838952288031578,
      "pose_rmse_dtheta": 0.39136531949043274,
      "pose_rmse_dx": 0.23184865713119507,
      "pose_rmse_dy": 0.17784316837787628,
      "pose_rmse_mean": 0.2670190632343292,
      "rmse_dtheta": 0.045363254845142365,
      "rmse_dx": 0.03266391158103943,
      "rmse_dy": 0.009097795933485031,
      "rmse_mean": 0.029041653499007225,
      "rotation_flip": 0.02150537632405758,
      "sparse_tokens": 1560.0,
      "step": 210,
      "turn_loss": 0.34566664695739746,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.009803010592826612,
      "grad_norm": 0.7938182950019836,
      "learning_rate": 9.998583973465647e-06,
      "loss": 0.1684,
      "mae_dtheta": 0.04480693116784096,
      "mae_dx": 0.015134844928979874,
      "mae_dy": 0.0066123721189796925,
      "pose_mae_dtheta": 0.404283344745636,
      "pose_mae_dx": 0.12652748823165894,
      "pose_mae_dy": 0.0846676304936409,
      "pose_rmse_dtheta": 0.660045325756073,
      "pose_rmse_dx": 0.2677152156829834,
      "pose_rmse_dy": 0.20217855274677277,
      "pose_rmse_mean": 0.37664636969566345,
      "rmse_dtheta": 0.06283333897590637,
      "rmse_dx": 0.028616635128855705,
      "rmse_dy": 0.012300862930715084,
      "rmse_mean": 0.03458361327648163,
      "rotation_flip": 0.02380952425301075,
      "sparse_tokens": 7139.0,
      "step": 211,
      "turn_loss": 0.37492042779922485,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.009849470358669392,
      "grad_norm": 0.6442590355873108,
      "learning_rate": 9.99855233291823e-06,
      "loss": 0.162,
      "mae_dtheta": 0.012453628703951836,
      "mae_dx": 0.002746750134974718,
      "mae_dy": 0.0030647164676338434,
      "pose_mae_dtheta": 0.08565400540828705,
      "pose_mae_dx": 0.03128216043114662,
      "pose_mae_dy": 0.034322578459978104,
      "pose_rmse_dtheta": 0.21633689105510712,
      "pose_rmse_dx": 0.09300614893436432,
      "pose_rmse_dy": 0.08287487179040909,
      "pose_rmse_mean": 0.13073930144309998,
      "rmse_dtheta": 0.026858659461140633,
      "rmse_dx": 0.009134898893535137,
      "rmse_dy": 0.007440212182700634,
      "rmse_mean": 0.014477923512458801,
      "rotation_flip": 0.004834810737520456,
      "sparse_tokens": 32105.0,
      "step": 212,
      "turn_loss": 0.12108641862869263,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16513.0,
      "epoch": 0.009895930124512172,
      "grad_norm": 1.2814743518829346,
      "learning_rate": 9.998520342819366e-06,
      "loss": 0.209,
      "mae_dtheta": 0.03482150286436081,
      "mae_dx": 0.015162670984864235,
      "mae_dy": 0.0061911907978355885,
      "pose_mae_dtheta": 0.2899382710456848,
      "pose_mae_dx": 0.13310138881206512,
      "pose_mae_dy": 0.09607671201229095,
      "pose_rmse_dtheta": 0.46874573826789856,
      "pose_rmse_dx": 0.26652514934539795,
      "pose_rmse_dy": 0.17829711735248566,
      "pose_rmse_mean": 0.30452266335487366,
      "rmse_dtheta": 0.049769043922424316,
      "rmse_dx": 0.02889748476445675,
      "rmse_dy": 0.009933165274560452,
      "rmse_mean": 0.029533233493566513,
      "rotation_flip": 0.01621621660888195,
      "sparse_tokens": 13240.0,
      "step": 213,
      "turn_loss": 0.2723046541213989,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.009942389890354952,
      "grad_norm": 1.0945137739181519,
      "learning_rate": 9.998488003171294e-06,
      "loss": 0.1683,
      "mae_dtheta": 0.012128963135182858,
      "mae_dx": 0.003844611579552293,
      "mae_dy": 0.002043681452050805,
      "pose_mae_dtheta": 0.09185917675495148,
      "pose_mae_dx": 0.03717542812228203,
      "pose_mae_dy": 0.026132572442293167,
      "pose_rmse_dtheta": 0.23382891714572906,
      "pose_rmse_dx": 0.08979422599077225,
      "pose_rmse_dy": 0.07314689457416534,
      "pose_rmse_mean": 0.13225668668746948,
      "rmse_dtheta": 0.029078468680381775,
      "rmse_dx": 0.01030608918517828,
      "rmse_dy": 0.005516750272363424,
      "rmse_mean": 0.01496710255742073,
      "rotation_flip": 0.006271104793995619,
      "sparse_tokens": 32169.0,
      "step": 214,
      "turn_loss": 0.11437801271677017,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.009988849656197733,
      "grad_norm": 1.1172645092010498,
      "learning_rate": 9.99845531397627e-06,
      "loss": 0.1704,
      "mae_dtheta": 0.025370802730321884,
      "mae_dx": 0.009885611943900585,
      "mae_dy": 0.004602133762091398,
      "pose_mae_dtheta": 0.19014282524585724,
      "pose_mae_dx": 0.08193545043468475,
      "pose_mae_dy": 0.058664530515670776,
      "pose_rmse_dtheta": 0.37805110216140747,
      "pose_rmse_dx": 0.19531600177288055,
      "pose_rmse_dy": 0.13828463852405548,
      "pose_rmse_mean": 0.2372172474861145,
      "rmse_dtheta": 0.043020229786634445,
      "rmse_dx": 0.022333936765789986,
      "rmse_dy": 0.009134778752923012,
      "rmse_mean": 0.024829648435115814,
      "rotation_flip": 0.01015965174883604,
      "sparse_tokens": 13789.0,
      "step": 215,
      "turn_loss": 0.20210155844688416,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.010035309422040513,
      "grad_norm": 0.5900186896324158,
      "learning_rate": 9.998422275236584e-06,
      "loss": 0.1014,
      "mae_dtheta": 0.031950198113918304,
      "mae_dx": 0.01020366232842207,
      "mae_dy": 0.005335645284503698,
      "pose_mae_dtheta": 0.23771460354328156,
      "pose_mae_dx": 0.07913172990083694,
      "pose_mae_dy": 0.06462354212999344,
      "pose_rmse_dtheta": 0.4307444393634796,
      "pose_rmse_dx": 0.19907833635807037,
      "pose_rmse_dy": 0.15527303516864777,
      "pose_rmse_mean": 0.2616986036300659,
      "rmse_dtheta": 0.0483180470764637,
      "rmse_dx": 0.022859305143356323,
      "rmse_dy": 0.01051229890435934,
      "rmse_mean": 0.027229882776737213,
      "rotation_flip": 0.0133843207731843,
      "sparse_tokens": 18103.0,
      "step": 216,
      "turn_loss": 0.25144603848457336,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.010081769187883293,
      "grad_norm": 0.6830938458442688,
      "learning_rate": 9.998388886954546e-06,
      "loss": 0.156,
      "mae_dtheta": 0.03801744803786278,
      "mae_dx": 0.016410520300269127,
      "mae_dy": 0.004734487738460302,
      "pose_mae_dtheta": 0.3125816285610199,
      "pose_mae_dx": 0.12874701619148254,
      "pose_mae_dy": 0.06026400998234749,
      "pose_rmse_dtheta": 0.5346447229385376,
      "pose_rmse_dx": 0.2738967537879944,
      "pose_rmse_dy": 0.13985088467597961,
      "pose_rmse_mean": 0.3161308169364929,
      "rmse_dtheta": 0.05688297003507614,
      "rmse_dx": 0.029958272352814674,
      "rmse_dy": 0.008810997009277344,
      "rmse_mean": 0.0318840816617012,
      "rotation_flip": 0.01573849841952324,
      "sparse_tokens": 12309.0,
      "step": 217,
      "turn_loss": 0.25817033648490906,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.010128228953726073,
      "grad_norm": 0.9733985066413879,
      "learning_rate": 9.998355149132491e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.006767422426491976,
      "mae_dx": 0.0020594357047230005,
      "mae_dy": 0.0008475103531964123,
      "pose_mae_dtheta": 0.046910304576158524,
      "pose_mae_dx": 0.018131151795387268,
      "pose_mae_dy": 0.012794571928679943,
      "pose_rmse_dtheta": 0.1466209590435028,
      "pose_rmse_dx": 0.049695443361997604,
      "pose_rmse_dy": 0.029278511181473732,
      "pose_rmse_mean": 0.07519830763339996,
      "rmse_dtheta": 0.021060867235064507,
      "rmse_dx": 0.006647700909525156,
      "rmse_dy": 0.001712355762720108,
      "rmse_mean": 0.009806974790990353,
      "rotation_flip": 0.003217503195628524,
      "sparse_tokens": 32137.0,
      "step": 218,
      "turn_loss": 0.05626387521624565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34283.0,
      "epoch": 0.010174688719568854,
      "grad_norm": 0.6507313251495361,
      "learning_rate": 9.998321061772776e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.03744739294052124,
      "mae_dx": 0.013320491649210453,
      "mae_dy": 0.0057156020775437355,
      "pose_mae_dtheta": 0.3013368248939514,
      "pose_mae_dx": 0.12255033105611801,
      "pose_mae_dy": 0.08173202723264694,
      "pose_rmse_dtheta": 0.501809298992157,
      "pose_rmse_dx": 0.25268009305000305,
      "pose_rmse_dy": 0.1813483089208603,
      "pose_rmse_mean": 0.31194591522216797,
      "rmse_dtheta": 0.05360556021332741,
      "rmse_dx": 0.025961466133594513,
      "rmse_dy": 0.011349886655807495,
      "rmse_mean": 0.030305638909339905,
      "rotation_flip": 0.015037594363093376,
      "sparse_tokens": 26592.0,
      "step": 219,
      "turn_loss": 0.27800509333610535,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.010221148485411634,
      "grad_norm": 0.7199276685714722,
      "learning_rate": 9.998286624877786e-06,
      "loss": 0.1586,
      "mae_dtheta": 0.02747993916273117,
      "mae_dx": 0.010702132247388363,
      "mae_dy": 0.0030338296201080084,
      "pose_mae_dtheta": 0.21084997057914734,
      "pose_mae_dx": 0.08344756066799164,
      "pose_mae_dy": 0.03415351361036301,
      "pose_rmse_dtheta": 0.4113960266113281,
      "pose_rmse_dx": 0.20975731313228607,
      "pose_rmse_dy": 0.0847545936703682,
      "pose_rmse_mean": 0.2353026568889618,
      "rmse_dtheta": 0.04516855254769325,
      "rmse_dx": 0.022919416427612305,
      "rmse_dy": 0.006410301197320223,
      "rmse_mean": 0.02483275532722473,
      "rotation_flip": 0.01600673981010914,
      "sparse_tokens": 21687.0,
      "step": 220,
      "turn_loss": 0.21026922762393951,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.010267608251254414,
      "grad_norm": 0.7990036606788635,
      "learning_rate": 9.998251838449932e-06,
      "loss": 0.1987,
      "mae_dtheta": 0.015948954969644547,
      "mae_dx": 0.004278672393411398,
      "mae_dy": 0.004570892080664635,
      "pose_mae_dtheta": 0.11498217284679413,
      "pose_mae_dx": 0.04806891083717346,
      "pose_mae_dy": 0.053219590336084366,
      "pose_rmse_dtheta": 0.23996616899967194,
      "pose_rmse_dx": 0.11748285591602325,
      "pose_rmse_dy": 0.13894057273864746,
      "pose_rmse_mean": 0.16546320915222168,
      "rmse_dtheta": 0.0286408644169569,
      "rmse_dx": 0.011100614443421364,
      "rmse_dy": 0.009974067099392414,
      "rmse_mean": 0.016571849584579468,
      "rotation_flip": 0.010387811809778214,
      "sparse_tokens": 32121.0,
      "step": 221,
      "turn_loss": 0.15720407664775848,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.010314068017097194,
      "grad_norm": 0.6635762453079224,
      "learning_rate": 9.998216702491643e-06,
      "loss": 0.1684,
      "mae_dtheta": 0.030888844281435013,
      "mae_dx": 0.012075128965079784,
      "mae_dy": 0.007179762236773968,
      "pose_mae_dtheta": 0.2453482300043106,
      "pose_mae_dx": 0.0936213806271553,
      "pose_mae_dy": 0.0931265726685524,
      "pose_rmse_dtheta": 0.39742591977119446,
      "pose_rmse_dx": 0.1964891105890274,
      "pose_rmse_dy": 0.19831815361976624,
      "pose_rmse_mean": 0.264077752828598,
      "rmse_dtheta": 0.04608054831624031,
      "rmse_dx": 0.02446816675364971,
      "rmse_dy": 0.012975501827895641,
      "rmse_mean": 0.02784140408039093,
      "rotation_flip": 0.013306038454174995,
      "sparse_tokens": 16665.0,
      "step": 222,
      "turn_loss": 0.27826443314552307,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.010360527782939975,
      "grad_norm": 0.4498447775840759,
      "learning_rate": 9.998181217005377e-06,
      "loss": 0.1221,
      "mae_dtheta": 0.012217003852128983,
      "mae_dx": 0.002579436171799898,
      "mae_dy": 0.002732790308073163,
      "pose_mae_dtheta": 0.08306949585676193,
      "pose_mae_dx": 0.030439112335443497,
      "pose_mae_dy": 0.03804316371679306,
      "pose_rmse_dtheta": 0.1818152666091919,
      "pose_rmse_dx": 0.08517713099718094,
      "pose_rmse_dy": 0.08169130980968475,
      "pose_rmse_mean": 0.11622790992259979,
      "rmse_dtheta": 0.023415539413690567,
      "rmse_dx": 0.00822305679321289,
      "rmse_dy": 0.005349354352802038,
      "rmse_mean": 0.012329316698014736,
      "rotation_flip": 0.005591054446995258,
      "sparse_tokens": 32105.0,
      "step": 223,
      "turn_loss": 0.10395379364490509,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.010406987548782755,
      "grad_norm": 0.5948088765144348,
      "learning_rate": 9.998145381993616e-06,
      "loss": 0.1334,
      "mae_dtheta": 0.012475996278226376,
      "mae_dx": 0.00266390317119658,
      "mae_dy": 0.002997002797201276,
      "pose_mae_dtheta": 0.08861370384693146,
      "pose_mae_dx": 0.029755672439932823,
      "pose_mae_dy": 0.03648049011826515,
      "pose_rmse_dtheta": 0.22003208100795746,
      "pose_rmse_dx": 0.07149957865476608,
      "pose_rmse_dy": 0.07489583641290665,
      "pose_rmse_mean": 0.122142493724823,
      "rmse_dtheta": 0.02549455687403679,
      "rmse_dx": 0.007432556711137295,
      "rmse_dy": 0.0068861679174005985,
      "rmse_mean": 0.013271095231175423,
      "rotation_flip": 0.005657237954437733,
      "sparse_tokens": 32153.0,
      "step": 224,
      "turn_loss": 0.10920573770999908,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.010453447314625535,
      "grad_norm": 0.6073485016822815,
      "learning_rate": 9.998109197458865e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.00970778614282608,
      "mae_dx": 0.0026826849207282066,
      "mae_dy": 0.0003827533219009638,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6073481440544128,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.0017547607422,
      "model/head/act_norm_mean": 117.5879794034091,
      "model/head/act_norm_min": 85.9163589477539,
      "model/head/act_over_embed": 80.80756032203048,
      "model/head/grad_frac": 0.10276956111192703,
      "model/head/grad_norm": 0.06241689994931221,
      "model/head/grad_zero_frac": 0.00013230233162175864,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.664974944760101,
      "model/head/update_ratio": 0.0010937905171886086,
      "model/head/weight_delta": 1.6929726600646973,
      "model/head/weight_delta_rel": 0.02969975583255291,
      "model/head/weight_norm": 57.06476593017578,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4090745151042938,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4090018687901161,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4089306592941284,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2810699133683924,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09723886847496033,
      "model/modality_embedder.encoders.pose/grad_norm": 0.059057846665382385,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5386978086099585,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001928734011016786,
      "model/modality_embedder.encoders.pose/weight_delta": 0.48773643374443054,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0159358698874712,
      "model/modality_embedder.encoders.pose/weight_norm": 30.620006561279297,
      "model/modality_embedder/grad_frac": 0.09723886847496033,
      "model/modality_embedder/grad_norm": 0.059057846665382385,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5386978086099585,
      "model/modality_embedder/update_ratio": 0.001928734011016786,
      "model/modality_embedder/weight_delta": 0.48773643374443054,
      "model/modality_embedder/weight_delta_rel": 0.0159358698874712,
      "model/modality_embedder/weight_norm": 30.620006561279297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.3586654663086,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.003249258457593,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.931821823120117,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.495257612372168,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08226560056209564,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04996386170387268,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018198367906734347,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.2051885426044464,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.007477194536477327,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.45513343811035,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.822998046875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.205231882315214,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.490777015686035,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.321271324625744,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07688330858945847,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.046694934368133545,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016160104423761368,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.22090066969394684,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.007652171887457371,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.895193099975586,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.60635375976562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.138981581689915,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.324628829956055,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.65016222208596,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07722475379705429,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.046902310103178024,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015733768232166767,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.21422117948532104,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.007193146273493767,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.809967041015625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.62510681152344,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.977831389289722,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.358694076538086,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.91383702545168,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08267031610012054,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.050209663808345795,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017147606704384089,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.17770016193389893,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.006072948221117258,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.280858993530273,
      "model/normalizer/grad_frac": 0.31433355808258057,
      "model/normalizer/grad_norm": 0.19090990722179413,
      "model/normalizer/grad_zero_frac": 0.00018435118545312434,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002457869239151478,
      "model/normalizer/weight_delta": 0.4243234097957611,
      "model/normalizer/weight_delta_rel": 0.005465039983391762,
      "model/normalizer/weight_norm": 77.67292785644531,
      "pose_mae_dtheta": 0.07041140645742416,
      "pose_mae_dx": 0.024126239120960236,
      "pose_mae_dy": 0.007090167608112097,
      "pose_rmse_dtheta": 0.24727992713451385,
      "pose_rmse_dx": 0.056577228009700775,
      "pose_rmse_dy": 0.012619581073522568,
      "pose_rmse_mean": 0.1054922491312027,
      "rmse_dtheta": 0.0314834862947464,
      "rmse_dx": 0.007154237944632769,
      "rmse_dy": 0.0006725803250446916,
      "rmse_mean": 0.013103434816002846,
      "rotation_flip": 0.003250270849093795,
      "sparse_tokens": 32249.0,
      "step": 225,
      "turn_loss": 0.06666573882102966,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35254.0,
      "epoch": 0.010499907080468314,
      "grad_norm": 0.8322863578796387,
      "learning_rate": 9.998072663403657e-06,
      "loss": 0.1798,
      "mae_dtheta": 0.0461232028901577,
      "mae_dx": 0.015761995688080788,
      "mae_dy": 0.006441464647650719,
      "pose_mae_dtheta": 0.4031815826892853,
      "pose_mae_dx": 0.13055318593978882,
      "pose_mae_dy": 0.08565571904182434,
      "pose_rmse_dtheta": 0.6365958452224731,
      "pose_rmse_dx": 0.2662293314933777,
      "pose_rmse_dy": 0.19898122549057007,
      "pose_rmse_mean": 0.36726880073547363,
      "rmse_dtheta": 0.06370938569307327,
      "rmse_dx": 0.02856285311281681,
      "rmse_dy": 0.01196686364710331,
      "rmse_mean": 0.03474636748433113,
      "rotation_flip": 0.010701545514166355,
      "sparse_tokens": 27452.0,
      "step": 226,
      "turn_loss": 0.3778068423271179,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.010546366846311094,
      "grad_norm": 0.44105562567710876,
      "learning_rate": 9.998035779830543e-06,
      "loss": 0.1445,
      "mae_dtheta": 0.010722160339355469,
      "mae_dx": 0.003201225772500038,
      "mae_dy": 0.0017188114579766989,
      "pose_mae_dtheta": 0.07648435235023499,
      "pose_mae_dx": 0.0312188807874918,
      "pose_mae_dy": 0.025813627988100052,
      "pose_rmse_dtheta": 0.18240951001644135,
      "pose_rmse_dx": 0.07579190284013748,
      "pose_rmse_dy": 0.06995170563459396,
      "pose_rmse_mean": 0.10938438028097153,
      "rmse_dtheta": 0.0241506639868021,
      "rmse_dx": 0.008869851939380169,
      "rmse_dy": 0.003978725988417864,
      "rmse_mean": 0.012333080172538757,
      "rotation_flip": 0.005664263851940632,
      "sparse_tokens": 32137.0,
      "step": 227,
      "turn_loss": 0.10372763872146606,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30723.0,
      "epoch": 0.010592826612153874,
      "grad_norm": 0.6002109050750732,
      "learning_rate": 9.997998546742106e-06,
      "loss": 0.2338,
      "mae_dtheta": 0.0375472754240036,
      "mae_dx": 0.018485326319932938,
      "mae_dy": 0.008362021297216415,
      "pose_mae_dtheta": 0.29626044631004333,
      "pose_mae_dx": 0.1652381718158722,
      "pose_mae_dy": 0.10886039584875107,
      "pose_rmse_dtheta": 0.4717980623245239,
      "pose_rmse_dx": 0.32686716318130493,
      "pose_rmse_dy": 0.2294938564300537,
      "pose_rmse_mean": 0.3427197337150574,
      "rmse_dtheta": 0.05142322927713394,
      "rmse_dx": 0.03203635290265083,
      "rmse_dy": 0.015291111543774605,
      "rmse_mean": 0.032916899770498276,
      "rotation_flip": 0.012451361864805222,
      "sparse_tokens": 22967.0,
      "step": 228,
      "turn_loss": 0.4053763151168823,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.010639286377996654,
      "grad_norm": 0.5963194370269775,
      "learning_rate": 9.997960964140946e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.015549187548458576,
      "mae_dx": 0.004125535953789949,
      "mae_dy": 0.005763811059296131,
      "pose_mae_dtheta": 0.11897513270378113,
      "pose_mae_dx": 0.0531587153673172,
      "pose_mae_dy": 0.06467980146408081,
      "pose_rmse_dtheta": 0.2645970582962036,
      "pose_rmse_dx": 0.12553910911083221,
      "pose_rmse_dy": 0.18150950968265533,
      "pose_rmse_mean": 0.19054856896400452,
      "rmse_dtheta": 0.028684139251708984,
      "rmse_dx": 0.01083463430404663,
      "rmse_dy": 0.013256891630589962,
      "rmse_mean": 0.017591889947652817,
      "rotation_flip": 0.004950494971126318,
      "sparse_tokens": 32089.0,
      "step": 229,
      "turn_loss": 0.15780989825725555,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.010685746143839435,
      "grad_norm": 0.462581068277359,
      "learning_rate": 9.997923032029695e-06,
      "loss": 0.1248,
      "mae_dtheta": 0.011955559253692627,
      "mae_dx": 0.00202350364997983,
      "mae_dy": 0.0025296208914369345,
      "pose_mae_dtheta": 0.0843590721487999,
      "pose_mae_dx": 0.030391016975045204,
      "pose_mae_dy": 0.03553556650876999,
      "pose_rmse_dtheta": 0.1650516390800476,
      "pose_rmse_dx": 0.07581306248903275,
      "pose_rmse_dy": 0.07871183007955551,
      "pose_rmse_mean": 0.10652551054954529,
      "rmse_dtheta": 0.023205161094665527,
      "rmse_dx": 0.006177176721394062,
      "rmse_dy": 0.005006106570363045,
      "rmse_mean": 0.01146281510591507,
      "rotation_flip": 0.00350330863147974,
      "sparse_tokens": 32089.0,
      "step": 230,
      "turn_loss": 0.08785316348075867,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.010732205909682215,
      "grad_norm": 0.6224492192268372,
      "learning_rate": 9.997884750411004e-06,
      "loss": 0.1464,
      "mae_dtheta": 0.02352655678987503,
      "mae_dx": 0.007702724542468786,
      "mae_dy": 0.0032241703011095524,
      "pose_mae_dtheta": 0.18693077564239502,
      "pose_mae_dx": 0.06204202026128769,
      "pose_mae_dy": 0.029375603422522545,
      "pose_rmse_dtheta": 0.26782360672950745,
      "pose_rmse_dx": 0.12096382677555084,
      "pose_rmse_dy": 0.06285162270069122,
      "pose_rmse_mean": 0.1505463570356369,
      "rmse_dtheta": 0.03623048588633537,
      "rmse_dx": 0.01664256490767002,
      "rmse_dy": 0.006737423595041037,
      "rmse_mean": 0.019870158284902573,
      "rotation_flip": 0.009900989942252636,
      "sparse_tokens": 6690.0,
      "step": 231,
      "turn_loss": 0.24356509745121002,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 41410.0,
      "epoch": 0.010778665675524995,
      "grad_norm": 0.5665127038955688,
      "learning_rate": 9.997846119287549e-06,
      "loss": 0.1805,
      "mae_dtheta": 0.04647316411137581,
      "mae_dx": 0.018310531973838806,
      "mae_dy": 0.006776885129511356,
      "pose_mae_dtheta": 0.40103647112846375,
      "pose_mae_dx": 0.1530389040708542,
      "pose_mae_dy": 0.07408734411001205,
      "pose_rmse_dtheta": 0.6517293453216553,
      "pose_rmse_dx": 0.30335015058517456,
      "pose_rmse_dy": 0.17928525805473328,
      "pose_rmse_mean": 0.37812158465385437,
      "rmse_dtheta": 0.06503507494926453,
      "rmse_dx": 0.03182226046919823,
      "rmse_dy": 0.014786665327847004,
      "rmse_mean": 0.037214670330286026,
      "rotation_flip": 0.009940357878804207,
      "sparse_tokens": 30010.0,
      "step": 232,
      "turn_loss": 0.4307181239128113,
      "turns": 128.0,
      "turns_per_sample": 128.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.010825125441367775,
      "grad_norm": 0.6318049430847168,
      "learning_rate": 9.997807138662033e-06,
      "loss": 0.102,
      "mae_dtheta": 0.00793053861707449,
      "mae_dx": 0.0019347931956872344,
      "mae_dy": 0.0012834774097427726,
      "pose_mae_dtheta": 0.05581635609269142,
      "pose_mae_dx": 0.020363803952932358,
      "pose_mae_dy": 0.01880980096757412,
      "pose_rmse_dtheta": 0.16902489960193634,
      "pose_rmse_dx": 0.0807780772447586,
      "pose_rmse_dy": 0.06065073236823082,
      "pose_rmse_mean": 0.10348457098007202,
      "rmse_dtheta": 0.021362708881497383,
      "rmse_dx": 0.007787993177771568,
      "rmse_dy": 0.0034245785791426897,
      "rmse_mean": 0.010858426801860332,
      "rotation_flip": 0.007766990456730127,
      "sparse_tokens": 32057.0,
      "step": 233,
      "turn_loss": 0.052728570997714996,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.010871585207210556,
      "grad_norm": 0.3756972551345825,
      "learning_rate": 9.99776780853718e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.010356014594435692,
      "mae_dx": 0.0017321305349469185,
      "mae_dy": 0.0021166622173041105,
      "pose_mae_dtheta": 0.07520980387926102,
      "pose_mae_dx": 0.021947529166936874,
      "pose_mae_dy": 0.029662156477570534,
      "pose_rmse_dtheta": 0.18665479123592377,
      "pose_rmse_dx": 0.054779309779405594,
      "pose_rmse_dy": 0.07398835569620132,
      "pose_rmse_mean": 0.105140820145607,
      "rmse_dtheta": 0.023392586037516594,
      "rmse_dx": 0.005226858891546726,
      "rmse_dy": 0.004515011329203844,
      "rmse_mean": 0.01104481890797615,
      "rotation_flip": 0.0027434842195361853,
      "sparse_tokens": 32105.0,
      "step": 234,
      "turn_loss": 0.08241111785173416,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.010918044973053336,
      "grad_norm": 0.6460689902305603,
      "learning_rate": 9.997728128915742e-06,
      "loss": 0.1574,
      "mae_dtheta": 0.045496031641960144,
      "mae_dx": 0.01544826477766037,
      "mae_dy": 0.005083490628749132,
      "pose_mae_dtheta": 0.39108985662460327,
      "pose_mae_dx": 0.1339735984802246,
      "pose_mae_dy": 0.0403173454105854,
      "pose_rmse_dtheta": 0.5877468585968018,
      "pose_rmse_dx": 0.25975027680397034,
      "pose_rmse_dy": 0.09452999383211136,
      "pose_rmse_mean": 0.31400904059410095,
      "rmse_dtheta": 0.06313016265630722,
      "rmse_dx": 0.02719453163444996,
      "rmse_dy": 0.011924666352570057,
      "rmse_mean": 0.03408312052488327,
      "rotation_flip": 0.015424164943397045,
      "sparse_tokens": 6690.0,
      "step": 235,
      "turn_loss": 0.41931119561195374,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.010964504738896116,
      "grad_norm": 0.6136139631271362,
      "learning_rate": 9.997688099800496e-06,
      "loss": 0.1655,
      "mae_dtheta": 0.04387536644935608,
      "mae_dx": 0.01634323038160801,
      "mae_dy": 0.0038258882705122232,
      "pose_mae_dtheta": 0.35627859830856323,
      "pose_mae_dx": 0.1192769780755043,
      "pose_mae_dy": 0.05503113567829132,
      "pose_rmse_dtheta": 0.624946653842926,
      "pose_rmse_dx": 0.28335726261138916,
      "pose_rmse_dy": 0.13830436766147614,
      "pose_rmse_mean": 0.3488694429397583,
      "rmse_dtheta": 0.06293033808469772,
      "rmse_dx": 0.03155525028705597,
      "rmse_dy": 0.006844140589237213,
      "rmse_mean": 0.033776577562093735,
      "rotation_flip": 0.01610305905342102,
      "sparse_tokens": 10142.0,
      "step": 236,
      "turn_loss": 0.33640119433403015,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.011010964504738896,
      "grad_norm": 0.47482678294181824,
      "learning_rate": 9.997647721194235e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.010832715779542923,
      "mae_dx": 0.002360742539167404,
      "mae_dy": 0.00032593196374364197,
      "pose_mae_dtheta": 0.08482785522937775,
      "pose_mae_dx": 0.0183716993778944,
      "pose_mae_dy": 0.005327635910362005,
      "pose_rmse_dtheta": 0.3038986921310425,
      "pose_rmse_dx": 0.040012288838624954,
      "pose_rmse_dy": 0.010858699679374695,
      "pose_rmse_mean": 0.1182565689086914,
      "rmse_dtheta": 0.033787019550800323,
      "rmse_dx": 0.006017665844410658,
      "rmse_dy": 0.0005057559465058148,
      "rmse_mean": 0.013436814770102501,
      "rotation_flip": 0.0044868201948702335,
      "sparse_tokens": 32249.0,
      "step": 237,
      "turn_loss": 0.0638737753033638,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.011057424270581677,
      "grad_norm": 0.5897095799446106,
      "learning_rate": 9.997606993099788e-06,
      "loss": 0.1615,
      "mae_dtheta": 0.032333023846149445,
      "mae_dx": 0.008575337007641792,
      "mae_dy": 0.0033585161436349154,
      "pose_mae_dtheta": 0.2425069808959961,
      "pose_mae_dx": 0.06732182204723358,
      "pose_mae_dy": 0.03142077475786209,
      "pose_rmse_dtheta": 0.41960498690605164,
      "pose_rmse_dx": 0.1637534648180008,
      "pose_rmse_dy": 0.10100124031305313,
      "pose_rmse_mean": 0.22811990976333618,
      "rmse_dtheta": 0.04852018505334854,
      "rmse_dx": 0.018586575984954834,
      "rmse_dy": 0.008299176581203938,
      "rmse_mean": 0.025135314092040062,
      "rotation_flip": 0.01908065937459469,
      "sparse_tokens": 19964.0,
      "step": 238,
      "turn_loss": 0.3069923222064972,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.011103884036424457,
      "grad_norm": 0.44758278131484985,
      "learning_rate": 9.997565915520003e-06,
      "loss": 0.1703,
      "mae_dtheta": 0.010586061514914036,
      "mae_dx": 0.00228673592209816,
      "mae_dy": 0.0022434424608945847,
      "pose_mae_dtheta": 0.0770774781703949,
      "pose_mae_dx": 0.03063386306166649,
      "pose_mae_dy": 0.03287290409207344,
      "pose_rmse_dtheta": 0.15624266862869263,
      "pose_rmse_dx": 0.08071626722812653,
      "pose_rmse_dy": 0.08498840034008026,
      "pose_rmse_mean": 0.1073157787322998,
      "rmse_dtheta": 0.020516974851489067,
      "rmse_dx": 0.007648745086044073,
      "rmse_dy": 0.004420975223183632,
      "rmse_mean": 0.010862231254577637,
      "rotation_flip": 0.003051106119528413,
      "sparse_tokens": 32105.0,
      "step": 239,
      "turn_loss": 0.08311886340379715,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.011150343802267237,
      "grad_norm": 0.43517544865608215,
      "learning_rate": 9.997524488457749e-06,
      "loss": 0.092,
      "mae_dtheta": 0.008397982455790043,
      "mae_dx": 0.0017236056737601757,
      "mae_dy": 0.0013159236405044794,
      "pose_mae_dtheta": 0.06176985800266266,
      "pose_mae_dx": 0.0161642674356699,
      "pose_mae_dy": 0.017908263951539993,
      "pose_rmse_dtheta": 0.17072942852973938,
      "pose_rmse_dx": 0.044922102242708206,
      "pose_rmse_dy": 0.044683247804641724,
      "pose_rmse_mean": 0.08677826821804047,
      "rmse_dtheta": 0.019232962280511856,
      "rmse_dx": 0.005707472562789917,
      "rmse_dy": 0.0028543388471007347,
      "rmse_mean": 0.009264925494790077,
      "rotation_flip": 0.004333694465458393,
      "sparse_tokens": 32105.0,
      "step": 240,
      "turn_loss": 0.06334492564201355,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.011196803568110017,
      "grad_norm": 0.7759945392608643,
      "learning_rate": 9.997482711915926e-06,
      "loss": 0.1267,
      "mae_dtheta": 0.007984936237335205,
      "mae_dx": 0.002704900223761797,
      "mae_dy": 0.0004615577927324921,
      "pose_mae_dtheta": 0.06830450892448425,
      "pose_mae_dx": 0.021749507635831833,
      "pose_mae_dy": 0.006796799600124359,
      "pose_rmse_dtheta": 0.2678387761116028,
      "pose_rmse_dx": 0.061478663235902786,
      "pose_rmse_dy": 0.013514498248696327,
      "pose_rmse_mean": 0.11427731812000275,
      "rmse_dtheta": 0.027421656996011734,
      "rmse_dx": 0.007815180346369743,
      "rmse_dy": 0.0007146260468289256,
      "rmse_mean": 0.011983821168541908,
      "rotation_flip": 0.003218884114176035,
      "sparse_tokens": 32137.0,
      "step": 241,
      "turn_loss": 0.06276760995388031,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.011243263333952798,
      "grad_norm": 0.36563625931739807,
      "learning_rate": 9.997440585897455e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.00934058241546154,
      "mae_dx": 0.0023070471361279488,
      "mae_dy": 0.0008987558539956808,
      "pose_mae_dtheta": 0.07014048844575882,
      "pose_mae_dx": 0.021326549351215363,
      "pose_mae_dy": 0.015219509601593018,
      "pose_rmse_dtheta": 0.22894816100597382,
      "pose_rmse_dx": 0.05678167566657066,
      "pose_rmse_dy": 0.04003867879509926,
      "pose_rmse_mean": 0.10858950018882751,
      "rmse_dtheta": 0.026003152132034302,
      "rmse_dx": 0.007219361606985331,
      "rmse_dy": 0.0020878538489341736,
      "rmse_mean": 0.011770123615860939,
      "rotation_flip": 0.0,
      "sparse_tokens": 32105.0,
      "step": 242,
      "turn_loss": 0.07008811831474304,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.011289723099795578,
      "grad_norm": 0.5525192022323608,
      "learning_rate": 9.997398110405281e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.03501972556114197,
      "mae_dx": 0.01052593532949686,
      "mae_dy": 0.007796084973961115,
      "pose_mae_dtheta": 0.2743304371833801,
      "pose_mae_dx": 0.10996996611356735,
      "pose_mae_dy": 0.10907186567783356,
      "pose_rmse_dtheta": 0.4435460865497589,
      "pose_rmse_dx": 0.20479528605937958,
      "pose_rmse_dy": 0.23890046775341034,
      "pose_rmse_mean": 0.2957472801208496,
      "rmse_dtheta": 0.05024508386850357,
      "rmse_dx": 0.021344667300581932,
      "rmse_dy": 0.013789022341370583,
      "rmse_mean": 0.028459591791033745,
      "rotation_flip": 0.018134715035557747,
      "sparse_tokens": 12833.0,
      "step": 243,
      "turn_loss": 0.2753673195838928,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.011336182865638356,
      "grad_norm": 0.7084556818008423,
      "learning_rate": 9.997355285442375e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.028991933912038803,
      "mae_dx": 0.01669338345527649,
      "mae_dy": 0.006240838672965765,
      "pose_mae_dtheta": 0.2236209362745285,
      "pose_mae_dx": 0.14594244956970215,
      "pose_mae_dy": 0.07774398475885391,
      "pose_rmse_dtheta": 0.4224909543991089,
      "pose_rmse_dx": 0.30504950881004333,
      "pose_rmse_dy": 0.18170475959777832,
      "pose_rmse_mean": 0.303081750869751,
      "rmse_dtheta": 0.04561203345656395,
      "rmse_dx": 0.03141051530838013,
      "rmse_dy": 0.012479589320719242,
      "rmse_mean": 0.029834046959877014,
      "rotation_flip": 0.011579818092286587,
      "sparse_tokens": 24100.0,
      "step": 244,
      "turn_loss": 0.28480297327041626,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.011382642631481137,
      "grad_norm": 0.46669942140579224,
      "learning_rate": 9.997312111011733e-06,
      "loss": 0.1029,
      "mae_dtheta": 0.011856735683977604,
      "mae_dx": 0.0025472482666373253,
      "mae_dy": 0.0026311438996344805,
      "pose_mae_dtheta": 0.08253523707389832,
      "pose_mae_dx": 0.03351949155330658,
      "pose_mae_dy": 0.03658318519592285,
      "pose_rmse_dtheta": 0.17976710200309753,
      "pose_rmse_dx": 0.09741261601448059,
      "pose_rmse_dy": 0.08412934094667435,
      "pose_rmse_mean": 0.12043635547161102,
      "rmse_dtheta": 0.02276242896914482,
      "rmse_dx": 0.008759821765124798,
      "rmse_dy": 0.00534624420106411,
      "rmse_mean": 0.0122894998639822,
      "rotation_flip": 0.0031645570416003466,
      "sparse_tokens": 32073.0,
      "step": 245,
      "turn_loss": 0.11301568895578384,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.011429102397323917,
      "grad_norm": 0.6738923192024231,
      "learning_rate": 9.997268587116372e-06,
      "loss": 0.1496,
      "mae_dtheta": 0.03280651569366455,
      "mae_dx": 0.0045928955078125,
      "mae_dy": 0.00963796116411686,
      "pose_mae_dtheta": 0.2259596735239029,
      "pose_mae_dx": 0.057719357311725616,
      "pose_mae_dy": 0.1376951038837433,
      "pose_rmse_dtheta": 0.4224081039428711,
      "pose_rmse_dx": 0.10802890360355377,
      "pose_rmse_dy": 0.32065483927726746,
      "pose_rmse_mean": 0.28369730710983276,
      "rmse_dtheta": 0.05000419542193413,
      "rmse_dx": 0.008343570865690708,
      "rmse_dy": 0.01753072254359722,
      "rmse_mean": 0.025292828679084778,
      "rotation_flip": 0.018987340852618217,
      "sparse_tokens": 2548.0,
      "step": 246,
      "turn_loss": 0.24138598144054413,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 10053.0,
      "epoch": 0.011475562163166697,
      "grad_norm": 0.5059452652931213,
      "learning_rate": 9.997224713759335e-06,
      "loss": 0.138,
      "mae_dtheta": 0.03842392936348915,
      "mae_dx": 0.018368009477853775,
      "mae_dy": 0.010093903169035912,
      "pose_mae_dtheta": 0.3231147825717926,
      "pose_mae_dx": 0.16118474304676056,
      "pose_mae_dy": 0.1304403692483902,
      "pose_rmse_dtheta": 0.5263573527336121,
      "pose_rmse_dx": 0.31642505526542664,
      "pose_rmse_dy": 0.29622530937194824,
      "pose_rmse_mean": 0.3796692490577698,
      "rmse_dtheta": 0.05256789177656174,
      "rmse_dx": 0.03152675926685333,
      "rmse_dy": 0.01862550713121891,
      "rmse_mean": 0.03424005210399628,
      "rotation_flip": 0.022573363035917282,
      "sparse_tokens": 8057.0,
      "step": 247,
      "turn_loss": 0.3585298955440521,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.011522021929009477,
      "grad_norm": 0.6801435947418213,
      "learning_rate": 9.997180490943693e-06,
      "loss": 0.1182,
      "mae_dtheta": 0.01711275801062584,
      "mae_dx": 0.003345817793160677,
      "mae_dy": 0.002797134453430772,
      "pose_mae_dtheta": 0.1206587627530098,
      "pose_mae_dx": 0.03564115986227989,
      "pose_mae_dy": 0.03912482038140297,
      "pose_rmse_dtheta": 0.25151416659355164,
      "pose_rmse_dx": 0.09019973874092102,
      "pose_rmse_dy": 0.08559934049844742,
      "pose_rmse_mean": 0.14243775606155396,
      "rmse_dtheta": 0.03202332928776741,
      "rmse_dx": 0.00995483249425888,
      "rmse_dy": 0.005612542852759361,
      "rmse_mean": 0.0158635675907135,
      "rotation_flip": 0.01044386439025402,
      "sparse_tokens": 32121.0,
      "step": 248,
      "turn_loss": 0.1408427655696869,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.011568481694852258,
      "grad_norm": 0.49794813990592957,
      "learning_rate": 9.997135918672536e-06,
      "loss": 0.142,
      "mae_dtheta": 0.04291404038667679,
      "mae_dx": 0.02360231988132,
      "mae_dy": 0.006350277457386255,
      "pose_mae_dtheta": 0.36584746837615967,
      "pose_mae_dx": 0.18413355946540833,
      "pose_mae_dy": 0.0798281729221344,
      "pose_rmse_dtheta": 0.5854479670524597,
      "pose_rmse_dx": 0.3253592252731323,
      "pose_rmse_dy": 0.19317527115345,
      "pose_rmse_mean": 0.36799415946006775,
      "rmse_dtheta": 0.06092032045125961,
      "rmse_dx": 0.03707466647028923,
      "rmse_dy": 0.01236815843731165,
      "rmse_mean": 0.036787714809179306,
      "rotation_flip": 0.01123595517128706,
      "sparse_tokens": 7398.0,
      "step": 249,
      "turn_loss": 0.3805978000164032,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.011614941460695038,
      "grad_norm": 0.5835611820220947,
      "learning_rate": 9.997090996948984e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.031703803688287735,
      "mae_dx": 0.01198655180633068,
      "mae_dy": 0.003876959439367056,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5835610628128052,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 143.51129150390625,
      "model/head/act_norm_mean": 105.82118443080357,
      "model/head/act_norm_min": 80.50929260253906,
      "model/head/act_over_embed": 72.7213086543858,
      "model/head/grad_frac": 0.09931176900863647,
      "model/head/grad_norm": 0.05795448273420334,
      "model/head/grad_zero_frac": 0.00016307769692502916,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6707938058035714,
      "model/head/update_ratio": 0.001015450805425644,
      "model/head/weight_delta": 1.7744050025939941,
      "model/head/weight_delta_rel": 0.03112831898033619,
      "model/head/weight_norm": 57.07266616821289,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4092974364757538,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4092485862865783,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.40919139981269836,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2812394599417668,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08139006793498993,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04749607294797897,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5253220942982456,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015510019147768617,
      "model/modality_embedder.encoders.pose/weight_delta": 0.5142967104911804,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.016803676262497902,
      "model/modality_embedder.encoders.pose/weight_norm": 30.622833251953125,
      "model/modality_embedder/grad_frac": 0.08139006793498993,
      "model/modality_embedder/grad_norm": 0.04749607294797897,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5253220942982456,
      "model/modality_embedder/update_ratio": 0.0015510019147768617,
      "model/modality_embedder/weight_delta": 0.5142967104911804,
      "model/modality_embedder/weight_delta_rel": 0.016803676262497902,
      "model/modality_embedder/weight_norm": 30.622833251953125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.48469543457031,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.85300852111678,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.03454303741455,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.704801408948114,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08174831420183182,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04770513251423836,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017374347662553191,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.21403555572032928,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.00779958488419652,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.45722198486328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.21331024169922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.83310081845238,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.493796348571777,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.378330011445794,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07875575125217438,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04595879092812538,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015903724124655128,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.23225437104701996,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.008045473136007786,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.898130416870117,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 76.11500549316406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.642562624007937,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.989468574523926,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.621809104671897,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08002310246229172,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04669836536049843,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001566363382153213,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.2267816811800003,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.007614904083311558,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.8132381439209,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.29450225830078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.63935613307823,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.926909446716309,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.994024298380367,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0974268838763237,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05685453489422798,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019415299175307155,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.18718960881233215,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.006397252436727285,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.283367156982422,
      "model/normalizer/grad_frac": 0.37284499406814575,
      "model/normalizer/grad_norm": 0.21757781505584717,
      "model/normalizer/grad_zero_frac": 0.00015008078480605036,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0028010716196149588,
      "model/normalizer/weight_delta": 0.44598880410194397,
      "model/normalizer/weight_delta_rel": 0.005744077730923891,
      "model/normalizer/weight_norm": 77.6766357421875,
      "pose_mae_dtheta": 0.23405176401138306,
      "pose_mae_dx": 0.09593233466148376,
      "pose_mae_dy": 0.05926760286092758,
      "pose_rmse_dtheta": 0.41688239574432373,
      "pose_rmse_dx": 0.21190117299556732,
      "pose_rmse_dy": 0.13875216245651245,
      "pose_rmse_mean": 0.25584524869918823,
      "rmse_dtheta": 0.04929737746715546,
      "rmse_dx": 0.024656331166625023,
      "rmse_dy": 0.0072137219831347466,
      "rmse_mean": 0.027055811136960983,
      "rotation_flip": 0.005889281630516052,
      "sparse_tokens": 15161.0,
      "step": 250,
      "turn_loss": 0.22232790291309357,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.011661401226537818,
      "grad_norm": 0.4971475601196289,
      "learning_rate": 9.997045725776175e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.02810226008296013,
      "mae_dx": 0.012476657517254353,
      "mae_dy": 0.002863676054403186,
      "pose_mae_dtheta": 0.22644779086112976,
      "pose_mae_dx": 0.10068394243717194,
      "pose_mae_dy": 0.05725252255797386,
      "pose_rmse_dtheta": 0.488621324300766,
      "pose_rmse_dx": 0.268433153629303,
      "pose_rmse_dy": 0.12590093910694122,
      "pose_rmse_mean": 0.29431846737861633,
      "rmse_dtheta": 0.04886876419186592,
      "rmse_dx": 0.027418553829193115,
      "rmse_dy": 0.006151904817670584,
      "rmse_mean": 0.027479741722345352,
      "rotation_flip": 0.011940298601984978,
      "sparse_tokens": 6726.0,
      "step": 251,
      "turn_loss": 0.18101631104946136,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.011707860992380598,
      "grad_norm": 0.45917949080467224,
      "learning_rate": 9.997000105157278e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.008698414079844952,
      "mae_dx": 0.0020097398664802313,
      "mae_dy": 0.0010217217495664954,
      "pose_mae_dtheta": 0.06308376789093018,
      "pose_mae_dx": 0.0186086967587471,
      "pose_mae_dy": 0.01574777439236641,
      "pose_rmse_dtheta": 0.1801261454820633,
      "pose_rmse_dx": 0.04627138748764992,
      "pose_rmse_dy": 0.040140509605407715,
      "pose_rmse_mean": 0.08884601294994354,
      "rmse_dtheta": 0.02336602658033371,
      "rmse_dx": 0.005588793195784092,
      "rmse_dy": 0.002075792057439685,
      "rmse_mean": 0.010343536734580994,
      "rotation_flip": 0.003411306068301201,
      "sparse_tokens": 32169.0,
      "step": 252,
      "turn_loss": 0.06112181395292282,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.011754320758223379,
      "grad_norm": 0.8710883259773254,
      "learning_rate": 9.99695413509548e-06,
      "loss": 0.2207,
      "mae_dtheta": 0.045130714774131775,
      "mae_dx": 0.01769617758691311,
      "mae_dy": 0.00863637961447239,
      "pose_mae_dtheta": 0.4033239483833313,
      "pose_mae_dx": 0.1521449238061905,
      "pose_mae_dy": 0.11017734557390213,
      "pose_rmse_dtheta": 0.6264384388923645,
      "pose_rmse_dx": 0.2855953872203827,
      "pose_rmse_dy": 0.253704309463501,
      "pose_rmse_mean": 0.3885793685913086,
      "rmse_dtheta": 0.06279285997152328,
      "rmse_dx": 0.029726581647992134,
      "rmse_dy": 0.017861034721136093,
      "rmse_mean": 0.03679349273443222,
      "rotation_flip": 0.012471655383706093,
      "sparse_tokens": 15335.0,
      "step": 253,
      "turn_loss": 0.4477776288986206,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.011800780524066159,
      "grad_norm": 0.7416402697563171,
      "learning_rate": 9.996907815593996e-06,
      "loss": 0.1521,
      "mae_dtheta": 0.009613431058824062,
      "mae_dx": 0.0025926968082785606,
      "mae_dy": 0.0025668032467365265,
      "pose_mae_dtheta": 0.07057369500398636,
      "pose_mae_dx": 0.03348982706665993,
      "pose_mae_dy": 0.03637605905532837,
      "pose_rmse_dtheta": 0.1385246217250824,
      "pose_rmse_dx": 0.10137911140918732,
      "pose_rmse_dy": 0.08482423424720764,
      "pose_rmse_mean": 0.10824265331029892,
      "rmse_dtheta": 0.01800859533250332,
      "rmse_dx": 0.008915945887565613,
      "rmse_dy": 0.005035139620304108,
      "rmse_mean": 0.01065322756767273,
      "rotation_flip": 0.005165733862668276,
      "sparse_tokens": 32073.0,
      "step": 254,
      "turn_loss": 0.0866391509771347,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.011847240289908939,
      "grad_norm": 0.45981544256210327,
      "learning_rate": 9.99686114665607e-06,
      "loss": 0.1505,
      "mae_dtheta": 0.012886620126664639,
      "mae_dx": 0.004948663059622049,
      "mae_dy": 0.003015074646100402,
      "pose_mae_dtheta": 0.09442957490682602,
      "pose_mae_dx": 0.0487518347799778,
      "pose_mae_dy": 0.03767351806163788,
      "pose_rmse_dtheta": 0.2207486927509308,
      "pose_rmse_dx": 0.12697258591651917,
      "pose_rmse_dy": 0.11034643650054932,
      "pose_rmse_mean": 0.15268924832344055,
      "rmse_dtheta": 0.02864358015358448,
      "rmse_dx": 0.01378485094755888,
      "rmse_dy": 0.00928670633584261,
      "rmse_mean": 0.017238378524780273,
      "rotation_flip": 0.009832841344177723,
      "sparse_tokens": 32089.0,
      "step": 255,
      "turn_loss": 0.16736344993114471,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.01189370005575172,
      "grad_norm": 0.40318676829338074,
      "learning_rate": 9.99681412828496e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.013542716391384602,
      "mae_dx": 0.002492025028914213,
      "mae_dy": 0.0025132265873253345,
      "pose_mae_dtheta": 0.09175186604261398,
      "pose_mae_dx": 0.03054848499596119,
      "pose_mae_dy": 0.03702240809798241,
      "pose_rmse_dtheta": 0.22163908183574677,
      "pose_rmse_dx": 0.07649500668048859,
      "pose_rmse_dy": 0.08342035859823227,
      "pose_rmse_mean": 0.12718482315540314,
      "rmse_dtheta": 0.0279863141477108,
      "rmse_dx": 0.007859398610889912,
      "rmse_dy": 0.005023726727813482,
      "rmse_mean": 0.013623146340250969,
      "rotation_flip": 0.006831119768321514,
      "sparse_tokens": 32073.0,
      "step": 256,
      "turn_loss": 0.08958495408296585,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.0119401598215945,
      "grad_norm": 0.6972535848617554,
      "learning_rate": 9.996766760483955e-06,
      "loss": 0.0909,
      "mae_dtheta": 0.006986621767282486,
      "mae_dx": 0.0015361832920461893,
      "mae_dy": 0.0008608375210314989,
      "pose_mae_dtheta": 0.054118525236845016,
      "pose_mae_dx": 0.013396767899394035,
      "pose_mae_dy": 0.009926576167345047,
      "pose_rmse_dtheta": 0.23822487890720367,
      "pose_rmse_dx": 0.04491312429308891,
      "pose_rmse_dy": 0.04006173834204674,
      "pose_rmse_mean": 0.10773324966430664,
      "rmse_dtheta": 0.02523374930024147,
      "rmse_dx": 0.0057718693278729916,
      "rmse_dy": 0.0037745346780866385,
      "rmse_mean": 0.01159338466823101,
      "rotation_flip": 0.0029013538733124733,
      "sparse_tokens": 32057.0,
      "step": 257,
      "turn_loss": 0.05175059661269188,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.01198661958743728,
      "grad_norm": 0.6662341356277466,
      "learning_rate": 9.99671904325637e-06,
      "loss": 0.154,
      "mae_dtheta": 0.03131052479147911,
      "mae_dx": 0.008350660093128681,
      "mae_dy": 0.006911930162459612,
      "pose_mae_dtheta": 0.25293466448783875,
      "pose_mae_dx": 0.07778460532426834,
      "pose_mae_dy": 0.09949617832899094,
      "pose_rmse_dtheta": 0.46132880449295044,
      "pose_rmse_dx": 0.1715686023235321,
      "pose_rmse_dy": 0.23550990223884583,
      "pose_rmse_mean": 0.2894690930843353,
      "rmse_dtheta": 0.05006095767021179,
      "rmse_dx": 0.018764106556773186,
      "rmse_dy": 0.012911729514598846,
      "rmse_mean": 0.027245599776506424,
      "rotation_flip": 0.007619047537446022,
      "sparse_tokens": 8909.0,
      "step": 258,
      "turn_loss": 0.1912519931793213,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.01203307935328006,
      "grad_norm": 0.797395646572113,
      "learning_rate": 9.99667097660554e-06,
      "loss": 0.2508,
      "mae_dtheta": 0.021996455267071724,
      "mae_dx": 0.009467506781220436,
      "mae_dy": 0.0023407379630953074,
      "pose_mae_dtheta": 0.15810349583625793,
      "pose_mae_dx": 0.06804924458265305,
      "pose_mae_dy": 0.021464766934514046,
      "pose_rmse_dtheta": 0.28671813011169434,
      "pose_rmse_dx": 0.16093577444553375,
      "pose_rmse_dy": 0.041904158890247345,
      "pose_rmse_mean": 0.16318601369857788,
      "rmse_dtheta": 0.035502538084983826,
      "rmse_dx": 0.02103525958955288,
      "rmse_dy": 0.004116586875170469,
      "rmse_mean": 0.020218130201101303,
      "rotation_flip": 0.013745704665780067,
      "sparse_tokens": 5604.0,
      "step": 259,
      "turn_loss": 0.17591872811317444,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 14899.0,
      "epoch": 0.01207953911912284,
      "grad_norm": 0.6986755132675171,
      "learning_rate": 9.996622560534827e-06,
      "loss": 0.1727,
      "mae_dtheta": 0.053575266152620316,
      "mae_dx": 0.014617632143199444,
      "mae_dy": 0.007283233571797609,
      "pose_mae_dtheta": 0.49456003308296204,
      "pose_mae_dx": 0.11741988360881805,
      "pose_mae_dy": 0.1152251586318016,
      "pose_rmse_dtheta": 0.7329469919204712,
      "pose_rmse_dx": 0.22702759504318237,
      "pose_rmse_dy": 0.26147329807281494,
      "pose_rmse_mean": 0.4071493148803711,
      "rmse_dtheta": 0.07167648524045944,
      "rmse_dx": 0.027099328115582466,
      "rmse_dy": 0.015337279066443443,
      "rmse_mean": 0.03803769871592522,
      "rotation_flip": 0.015364916995167732,
      "sparse_tokens": 12549.0,
      "step": 260,
      "turn_loss": 0.349882036447525,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.01212599888496562,
      "grad_norm": 0.4859314262866974,
      "learning_rate": 9.996573795047616e-06,
      "loss": 0.1458,
      "mae_dtheta": 0.01045422162860632,
      "mae_dx": 0.001729897572658956,
      "mae_dy": 0.002060548635199666,
      "pose_mae_dtheta": 0.07545066624879837,
      "pose_mae_dx": 0.024301208555698395,
      "pose_mae_dy": 0.02918831631541252,
      "pose_rmse_dtheta": 0.1690681129693985,
      "pose_rmse_dx": 0.059887807816267014,
      "pose_rmse_dy": 0.06888476759195328,
      "pose_rmse_mean": 0.0992802307009697,
      "rmse_dtheta": 0.022076312452554703,
      "rmse_dx": 0.005229554604738951,
      "rmse_dy": 0.004248463548719883,
      "rmse_mean": 0.010518110357224941,
      "rotation_flip": 0.003086419776082039,
      "sparse_tokens": 32073.0,
      "step": 261,
      "turn_loss": 0.08471488207578659,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.012172458650808399,
      "grad_norm": 0.7650392651557922,
      "learning_rate": 9.996524680147318e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.008169235661625862,
      "mae_dx": 0.0024733617901802063,
      "mae_dy": 0.0003602028882596642,
      "pose_mae_dtheta": 0.06142624467611313,
      "pose_mae_dx": 0.01868285983800888,
      "pose_mae_dy": 0.005116795189678669,
      "pose_rmse_dtheta": 0.19089791178703308,
      "pose_rmse_dx": 0.04458325356245041,
      "pose_rmse_dy": 0.012310536578297615,
      "pose_rmse_mean": 0.08259724080562592,
      "rmse_dtheta": 0.024881213903427124,
      "rmse_dx": 0.006697577890008688,
      "rmse_dy": 0.0006872386438772082,
      "rmse_mean": 0.010755343362689018,
      "rotation_flip": 0.0012307692086324096,
      "sparse_tokens": 32233.0,
      "step": 262,
      "turn_loss": 0.06031337380409241,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.01221891841665118,
      "grad_norm": 0.6886204481124878,
      "learning_rate": 9.996475215837366e-06,
      "loss": 0.2095,
      "mae_dtheta": 0.009609183296561241,
      "mae_dx": 0.0021258171182125807,
      "mae_dy": 0.002014041878283024,
      "pose_mae_dtheta": 0.06483572721481323,
      "pose_mae_dx": 0.023810697719454765,
      "pose_mae_dy": 0.027265828102827072,
      "pose_rmse_dtheta": 0.16516122221946716,
      "pose_rmse_dx": 0.06719569861888885,
      "pose_rmse_dy": 0.07031571865081787,
      "pose_rmse_mean": 0.1008908748626709,
      "rmse_dtheta": 0.02107364498078823,
      "rmse_dx": 0.007094333413988352,
      "rmse_dy": 0.004510176833719015,
      "rmse_mean": 0.010892718099057674,
      "rotation_flip": 0.007718282751739025,
      "sparse_tokens": 32089.0,
      "step": 263,
      "turn_loss": 0.08131977170705795,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.01226537818249396,
      "grad_norm": 0.9124003052711487,
      "learning_rate": 9.996425402121224e-06,
      "loss": 0.1987,
      "mae_dtheta": 0.0383957102894783,
      "mae_dx": 0.016711704432964325,
      "mae_dy": 0.007141484878957272,
      "pose_mae_dtheta": 0.30105337500572205,
      "pose_mae_dx": 0.12921972572803497,
      "pose_mae_dy": 0.09472446143627167,
      "pose_rmse_dtheta": 0.46109071373939514,
      "pose_rmse_dx": 0.23853029310703278,
      "pose_rmse_dy": 0.20802180469036102,
      "pose_rmse_mean": 0.3025476336479187,
      "rmse_dtheta": 0.052407000213861465,
      "rmse_dx": 0.028065161779522896,
      "rmse_dy": 0.013641445897519588,
      "rmse_mean": 0.03137120604515076,
      "rotation_flip": 0.01899592950940132,
      "sparse_tokens": 11405.0,
      "step": 264,
      "turn_loss": 0.35451996326446533,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.01231183794833674,
      "grad_norm": 0.91817307472229,
      "learning_rate": 9.99637523900237e-06,
      "loss": 0.3236,
      "mae_dtheta": 0.03412806615233421,
      "mae_dx": 0.013288372196257114,
      "mae_dy": 0.011372403241693974,
      "pose_mae_dtheta": 0.26016780734062195,
      "pose_mae_dx": 0.1256042867898941,
      "pose_mae_dy": 0.13703851401805878,
      "pose_rmse_dtheta": 0.4090411067008972,
      "pose_rmse_dx": 0.23958545923233032,
      "pose_rmse_dy": 0.2764914929866791,
      "pose_rmse_mean": 0.30837270617485046,
      "rmse_dtheta": 0.0493139922618866,
      "rmse_dx": 0.024493761360645294,
      "rmse_dy": 0.020537933334708214,
      "rmse_mean": 0.03144856542348862,
      "rotation_flip": 0.015306122601032257,
      "sparse_tokens": 6296.0,
      "step": 265,
      "turn_loss": 0.36673474311828613,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.01235829771417952,
      "grad_norm": 0.5215866565704346,
      "learning_rate": 9.996324726484313e-06,
      "loss": 0.1649,
      "mae_dtheta": 0.03966958075761795,
      "mae_dx": 0.012231054715812206,
      "mae_dy": 0.004504424054175615,
      "pose_mae_dtheta": 0.31396153569221497,
      "pose_mae_dx": 0.09911537915468216,
      "pose_mae_dy": 0.04667898267507553,
      "pose_rmse_dtheta": 0.5335497260093689,
      "pose_rmse_dx": 0.19549791514873505,
      "pose_rmse_dy": 0.1088983565568924,
      "pose_rmse_mean": 0.27931535243988037,
      "rmse_dtheta": 0.05856902152299881,
      "rmse_dx": 0.023554321378469467,
      "rmse_dy": 0.009458374232053757,
      "rmse_mean": 0.03052723966538906,
      "rotation_flip": 0.015012510120868683,
      "sparse_tokens": 20793.0,
      "step": 266,
      "turn_loss": 0.29416415095329285,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.0124047574800223,
      "grad_norm": 0.5801473259925842,
      "learning_rate": 9.996273864570585e-06,
      "loss": 0.1553,
      "mae_dtheta": 0.032961271703243256,
      "mae_dx": 0.008975908160209656,
      "mae_dy": 0.003653153544291854,
      "pose_mae_dtheta": 0.2629195749759674,
      "pose_mae_dx": 0.06958983838558197,
      "pose_mae_dy": 0.042458076030015945,
      "pose_rmse_dtheta": 0.5107809901237488,
      "pose_rmse_dx": 0.16475310921669006,
      "pose_rmse_dy": 0.10366389900445938,
      "pose_rmse_mean": 0.2597326934337616,
      "rmse_dtheta": 0.053917497396469116,
      "rmse_dx": 0.02020648494362831,
      "rmse_dy": 0.006759416311979294,
      "rmse_mean": 0.026961132884025574,
      "rotation_flip": 0.021176470443606377,
      "sparse_tokens": 7563.0,
      "step": 267,
      "turn_loss": 0.1916792392730713,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.01245121724586508,
      "grad_norm": 0.8021717667579651,
      "learning_rate": 9.996222653264746e-06,
      "loss": 0.1724,
      "mae_dtheta": 0.015909254550933838,
      "mae_dx": 0.003514010226354003,
      "mae_dy": 0.005605223122984171,
      "pose_mae_dtheta": 0.1235269159078598,
      "pose_mae_dx": 0.05089639872312546,
      "pose_mae_dy": 0.0673181340098381,
      "pose_rmse_dtheta": 0.25318968296051025,
      "pose_rmse_dx": 0.11978797614574432,
      "pose_rmse_dy": 0.17645429074764252,
      "pose_rmse_mean": 0.1831440031528473,
      "rmse_dtheta": 0.02836178056895733,
      "rmse_dx": 0.008902348577976227,
      "rmse_dy": 0.012308545410633087,
      "rmse_mean": 0.01652422547340393,
      "rotation_flip": 0.005606166552752256,
      "sparse_tokens": 32105.0,
      "step": 268,
      "turn_loss": 0.14965170621871948,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30077.0,
      "epoch": 0.01249767701170786,
      "grad_norm": 0.8064184188842773,
      "learning_rate": 9.996171092570374e-06,
      "loss": 0.209,
      "mae_dtheta": 0.03861946985125542,
      "mae_dx": 0.016899537295103073,
      "mae_dy": 0.005450116004794836,
      "pose_mae_dtheta": 0.32693812251091003,
      "pose_mae_dx": 0.12879906594753265,
      "pose_mae_dy": 0.06821910291910172,
      "pose_rmse_dtheta": 0.5349477529525757,
      "pose_rmse_dx": 0.25137025117874146,
      "pose_rmse_dy": 0.15729527175426483,
      "pose_rmse_mean": 0.31453776359558105,
      "rmse_dtheta": 0.05646120011806488,
      "rmse_dx": 0.029795613139867783,
      "rmse_dy": 0.010093700140714645,
      "rmse_mean": 0.0321168415248394,
      "rotation_flip": 0.015804598107933998,
      "sparse_tokens": 23181.0,
      "step": 269,
      "turn_loss": 0.28969019651412964,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.012544136777550641,
      "grad_norm": 0.45466822385787964,
      "learning_rate": 9.996119182491078e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.008987844921648502,
      "mae_dx": 0.002394485054537654,
      "mae_dy": 0.0015657249605283141,
      "pose_mae_dtheta": 0.07295408844947815,
      "pose_mae_dx": 0.028245506808161736,
      "pose_mae_dy": 0.02495422028005123,
      "pose_rmse_dtheta": 0.17815209925174713,
      "pose_rmse_dx": 0.0673891082406044,
      "pose_rmse_dy": 0.06393899768590927,
      "pose_rmse_mean": 0.1031600758433342,
      "rmse_dtheta": 0.01995336450636387,
      "rmse_dx": 0.006518817972391844,
      "rmse_dy": 0.00353614310733974,
      "rmse_mean": 0.010002775117754936,
      "rotation_flip": 0.0012695725308731198,
      "sparse_tokens": 32169.0,
      "step": 270,
      "turn_loss": 0.07067761570215225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.012590596543393421,
      "grad_norm": 0.5092256665229797,
      "learning_rate": 9.996066923030484e-06,
      "loss": 0.1278,
      "mae_dtheta": 0.009904145263135433,
      "mae_dx": 0.0018102630274370313,
      "mae_dy": 0.002518377033993602,
      "pose_mae_dtheta": 0.07063119858503342,
      "pose_mae_dx": 0.024923617020249367,
      "pose_mae_dy": 0.03504836931824684,
      "pose_rmse_dtheta": 0.13933835923671722,
      "pose_rmse_dx": 0.06429360061883926,
      "pose_rmse_dy": 0.08823428303003311,
      "pose_rmse_mean": 0.09728875011205673,
      "rmse_dtheta": 0.018897386267781258,
      "rmse_dx": 0.005193366669118404,
      "rmse_dy": 0.005515989847481251,
      "rmse_mean": 0.009868914261460304,
      "rotation_flip": 0.004688831977546215,
      "sparse_tokens": 32073.0,
      "step": 271,
      "turn_loss": 0.08580414205789566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.012637056309236202,
      "grad_norm": 0.5431584715843201,
      "learning_rate": 9.996014314192249e-06,
      "loss": 0.1422,
      "mae_dtheta": 0.02821166254580021,
      "mae_dx": 0.021222855895757675,
      "mae_dy": 0.006155998446047306,
      "pose_mae_dtheta": 0.2176385223865509,
      "pose_mae_dx": 0.16013330221176147,
      "pose_mae_dy": 0.07318340241909027,
      "pose_rmse_dtheta": 0.46776890754699707,
      "pose_rmse_dx": 0.2934860587120056,
      "pose_rmse_dy": 0.17359575629234314,
      "pose_rmse_mean": 0.3116168975830078,
      "rmse_dtheta": 0.0462530143558979,
      "rmse_dx": 0.03550628945231438,
      "rmse_dy": 0.012781696394085884,
      "rmse_mean": 0.03151366859674454,
      "rotation_flip": 0.016597511246800423,
      "sparse_tokens": 4426.0,
      "step": 272,
      "turn_loss": 0.3537048101425171,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.012683516075078982,
      "grad_norm": 0.5838435292243958,
      "learning_rate": 9.995961355980052e-06,
      "loss": 0.1299,
      "mae_dtheta": 0.010914468206465244,
      "mae_dx": 0.0022449763491749763,
      "mae_dy": 0.002783492673188448,
      "pose_mae_dtheta": 0.08517429977655411,
      "pose_mae_dx": 0.027685048058629036,
      "pose_mae_dy": 0.03528527542948723,
      "pose_rmse_dtheta": 0.2052975594997406,
      "pose_rmse_dx": 0.071319580078125,
      "pose_rmse_dy": 0.10023780167102814,
      "pose_rmse_mean": 0.1256183236837387,
      "rmse_dtheta": 0.02343275398015976,
      "rmse_dx": 0.006583970971405506,
      "rmse_dy": 0.00632135383784771,
      "rmse_mean": 0.01211269199848175,
      "rotation_flip": 0.00669176084920764,
      "sparse_tokens": 32089.0,
      "step": 273,
      "turn_loss": 0.08262848109006882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.012729975840921762,
      "grad_norm": 0.5320128798484802,
      "learning_rate": 9.995908048397596e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.009064292535185814,
      "mae_dx": 0.0020037549547851086,
      "mae_dy": 0.002461155178025365,
      "pose_mae_dtheta": 0.06090588867664337,
      "pose_mae_dx": 0.026239044964313507,
      "pose_mae_dy": 0.029968492686748505,
      "pose_rmse_dtheta": 0.10875102877616882,
      "pose_rmse_dx": 0.06619666516780853,
      "pose_rmse_dy": 0.06832615286111832,
      "pose_rmse_mean": 0.08109128475189209,
      "rmse_dtheta": 0.016647258773446083,
      "rmse_dx": 0.006025910377502441,
      "rmse_dy": 0.00496324710547924,
      "rmse_mean": 0.009212139062583447,
      "rotation_flip": 0.005840633995831013,
      "sparse_tokens": 32073.0,
      "step": 274,
      "turn_loss": 0.08171730488538742,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29108.0,
      "epoch": 0.012776435606764542,
      "grad_norm": 1.072116494178772,
      "learning_rate": 9.995854391448607e-06,
      "loss": 0.307,
      "mae_dtheta": 0.032660722732543945,
      "mae_dx": 0.01648806221783161,
      "mae_dy": 0.0076028346084058285,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999990463256836,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 133.42820739746094,
      "model/head/act_norm_mean": 94.7398654513889,
      "model/head/act_norm_min": 54.15302276611328,
      "model/head/act_over_embed": 65.10612250678922,
      "model/head/grad_frac": 0.11858917772769928,
      "model/head/grad_norm": 0.11858906596899033,
      "model/head/grad_zero_frac": 0.0001583186094649136,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6896918402777777,
      "model/head/update_ratio": 0.002077548997476697,
      "model/head/weight_delta": 1.850034475326538,
      "model/head/weight_delta_rel": 0.03245508298277855,
      "model/head/weight_norm": 57.08123779296875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.40922150015830994,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.40922150015830994,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.40922150015830994,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2812208461008365,
      "model/modality_embedder.encoders.pose/grad_frac": 0.03368992358446121,
      "model/modality_embedder.encoders.pose/grad_norm": 0.033689890056848526,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011000336380675435,
      "model/modality_embedder.encoders.pose/weight_delta": 0.5367263555526733,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.017536522820591927,
      "model/modality_embedder.encoders.pose/weight_norm": 30.626235961914062,
      "model/modality_embedder/grad_frac": 0.03368992358446121,
      "model/modality_embedder/grad_norm": 0.033689890056848526,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0011000336380675435,
      "model/modality_embedder/weight_delta": 0.5367263555526733,
      "model/modality_embedder/weight_delta_rel": 0.017536522820591927,
      "model/modality_embedder/weight_norm": 30.626235961914062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.7556381225586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.72223048941799,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.982934951782227,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.927720159053978,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.12449514120817184,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.1244950219988823,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.004533796105533838,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.2295047491788864,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.008363291621208191,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.459335327148438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.35010528564453,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.637300209435626,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.486961364746094,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.556564637667794,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10531023144721985,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.10531013458967209,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0036435651127249002,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.25058457255363464,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.00868044514209032,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.903047561645508,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 77.79269409179688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.359344686948855,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.664955139160156,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.73996972464929,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10935884714126587,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.10935874283313751,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0036675415467470884,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.24422088265419006,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.008200479671359062,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.817996978759766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 78.45491027832031,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.439371141975307,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.61281967163086,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.16938337805795,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10501141101121902,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.10501131415367126,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.003585635218769312,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.20203916728496552,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.006904739886522293,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.28666877746582,
      "model/normalizer/grad_frac": 0.4325820505619049,
      "model/normalizer/grad_norm": 0.4325816333293915,
      "model/normalizer/grad_zero_frac": 0.00012526426871772856,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.005568680819123983,
      "model/normalizer/weight_delta": 0.4800995886325836,
      "model/normalizer/weight_delta_rel": 0.006183404941111803,
      "model/normalizer/weight_norm": 77.68116760253906,
      "pose_mae_dtheta": 0.2568499445915222,
      "pose_mae_dx": 0.1530594378709793,
      "pose_mae_dy": 0.1035318449139595,
      "pose_rmse_dtheta": 0.43305283784866333,
      "pose_rmse_dx": 0.30493366718292236,
      "pose_rmse_dy": 0.1955796182155609,
      "pose_rmse_mean": 0.3111886978149414,
      "rmse_dtheta": 0.04773856699466705,
      "rmse_dx": 0.030592305585741997,
      "rmse_dy": 0.013922762125730515,
      "rmse_mean": 0.030751213431358337,
      "rotation_flip": 0.007450331002473831,
      "sparse_tokens": 23905.0,
      "step": 275,
      "turn_loss": 0.3199611306190491,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.012822895372607323,
      "grad_norm": 0.8665629029273987,
      "learning_rate": 9.99580038513684e-06,
      "loss": 0.142,
      "mae_dtheta": 0.03739442303776741,
      "mae_dx": 0.008813060820102692,
      "mae_dy": 0.005978127475827932,
      "pose_mae_dtheta": 0.2951599359512329,
      "pose_mae_dx": 0.0685102716088295,
      "pose_mae_dy": 0.07066056877374649,
      "pose_rmse_dtheta": 0.5399765968322754,
      "pose_rmse_dx": 0.16794048249721527,
      "pose_rmse_dy": 0.17236623167991638,
      "pose_rmse_mean": 0.29342779517173767,
      "rmse_dtheta": 0.05877431482076645,
      "rmse_dx": 0.019606981426477432,
      "rmse_dy": 0.012965699657797813,
      "rmse_mean": 0.030449001118540764,
      "rotation_flip": 0.02149178273975849,
      "sparse_tokens": 14036.0,
      "step": 276,
      "turn_loss": 0.3069818615913391,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.012869355138450103,
      "grad_norm": 1.194838285446167,
      "learning_rate": 9.995746029466071e-06,
      "loss": 0.2964,
      "mae_dtheta": 0.043862953782081604,
      "mae_dx": 0.016664931550621986,
      "mae_dy": 0.004500419832766056,
      "pose_mae_dtheta": 0.3653271496295929,
      "pose_mae_dx": 0.1545308530330658,
      "pose_mae_dy": 0.0458892360329628,
      "pose_rmse_dtheta": 0.5855823755264282,
      "pose_rmse_dx": 0.30913153290748596,
      "pose_rmse_dy": 0.10485529154539108,
      "pose_rmse_mean": 0.3331897258758545,
      "rmse_dtheta": 0.06099804490804672,
      "rmse_dx": 0.029843460768461227,
      "rmse_dy": 0.008540027774870396,
      "rmse_mean": 0.03312717750668526,
      "rotation_flip": 0.020123839378356934,
      "sparse_tokens": 10648.0,
      "step": 277,
      "turn_loss": 0.2923688292503357,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.012915814904292883,
      "grad_norm": 0.6418599486351013,
      "learning_rate": 9.9956913244401e-06,
      "loss": 0.131,
      "mae_dtheta": 0.008600868284702301,
      "mae_dx": 0.0017992618959397078,
      "mae_dy": 0.0012913497630506754,
      "pose_mae_dtheta": 0.06460103392601013,
      "pose_mae_dx": 0.01778336614370346,
      "pose_mae_dy": 0.020639294758439064,
      "pose_rmse_dtheta": 0.18528538942337036,
      "pose_rmse_dx": 0.05318368971347809,
      "pose_rmse_dy": 0.051962997764348984,
      "pose_rmse_mean": 0.09681069105863571,
      "rmse_dtheta": 0.021765802055597305,
      "rmse_dx": 0.006058016326278448,
      "rmse_dy": 0.0028470950201153755,
      "rmse_mean": 0.010223638266324997,
      "rotation_flip": 0.0035264482721686363,
      "sparse_tokens": 32105.0,
      "step": 278,
      "turn_loss": 0.056403208523988724,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.012962274670135663,
      "grad_norm": 0.8703759908676147,
      "learning_rate": 9.995636270062753e-06,
      "loss": 0.1444,
      "mae_dtheta": 0.016133982688188553,
      "mae_dx": 0.002547384239733219,
      "mae_dy": 0.0039694891311228275,
      "pose_mae_dtheta": 0.1168869137763977,
      "pose_mae_dx": 0.037039514631032944,
      "pose_mae_dy": 0.052895426750183105,
      "pose_rmse_dtheta": 0.27028363943099976,
      "pose_rmse_dx": 0.10050393640995026,
      "pose_rmse_dy": 0.14630267024040222,
      "pose_rmse_mean": 0.17236340045928955,
      "rmse_dtheta": 0.03089112974703312,
      "rmse_dx": 0.0073756324127316475,
      "rmse_dy": 0.008608018979430199,
      "rmse_mean": 0.015624928288161755,
      "rotation_flip": 0.0045968880876898766,
      "sparse_tokens": 32073.0,
      "step": 279,
      "turn_loss": 0.1332235336303711,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.013008734435978442,
      "grad_norm": 0.6250718832015991,
      "learning_rate": 9.995580866337883e-06,
      "loss": 0.1819,
      "mae_dtheta": 0.02573079615831375,
      "mae_dx": 0.006941740866750479,
      "mae_dy": 0.0057286787778139114,
      "pose_mae_dtheta": 0.20726102590560913,
      "pose_mae_dx": 0.07280539721250534,
      "pose_mae_dy": 0.10048401355743408,
      "pose_rmse_dtheta": 0.3595901429653168,
      "pose_rmse_dx": 0.1551489233970642,
      "pose_rmse_dy": 0.2130298912525177,
      "pose_rmse_mean": 0.24258963763713837,
      "rmse_dtheta": 0.04125504940748215,
      "rmse_dx": 0.017014652490615845,
      "rmse_dy": 0.00885861087590456,
      "rmse_mean": 0.022376105189323425,
      "rotation_flip": 0.006825938355177641,
      "sparse_tokens": 12468.0,
      "step": 280,
      "turn_loss": 0.21674902737140656,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.013055194201821222,
      "grad_norm": 0.5184781551361084,
      "learning_rate": 9.99552511326936e-06,
      "loss": 0.1236,
      "mae_dtheta": 0.04369007423520088,
      "mae_dx": 0.017586449161171913,
      "mae_dy": 0.007701600436121225,
      "pose_mae_dtheta": 0.3642233610153198,
      "pose_mae_dx": 0.15840838849544525,
      "pose_mae_dy": 0.08648616075515747,
      "pose_rmse_dtheta": 0.5872546434402466,
      "pose_rmse_dx": 0.3096012473106384,
      "pose_rmse_dy": 0.2117762416601181,
      "pose_rmse_mean": 0.36954402923583984,
      "rmse_dtheta": 0.06079045683145523,
      "rmse_dx": 0.02992917411029339,
      "rmse_dy": 0.016842421144247055,
      "rmse_mean": 0.03585401922464371,
      "rotation_flip": 0.015411973930895329,
      "sparse_tokens": 26714.0,
      "step": 281,
      "turn_loss": 0.3710874915122986,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.013101653967664002,
      "grad_norm": 0.6441404819488525,
      "learning_rate": 9.995469010861085e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.011664774268865585,
      "mae_dx": 0.0017071301117539406,
      "mae_dy": 0.0023335868027061224,
      "pose_mae_dtheta": 0.08585250377655029,
      "pose_mae_dx": 0.023980513215065002,
      "pose_mae_dy": 0.030518213286995888,
      "pose_rmse_dtheta": 0.2252705842256546,
      "pose_rmse_dx": 0.06356137245893478,
      "pose_rmse_dy": 0.07327844947576523,
      "pose_rmse_mean": 0.12070347368717194,
      "rmse_dtheta": 0.027409333735704422,
      "rmse_dx": 0.005029501859098673,
      "rmse_dy": 0.0051753283478319645,
      "rmse_mean": 0.012538055889308453,
      "rotation_flip": 0.004805381875485182,
      "sparse_tokens": 32057.0,
      "step": 282,
      "turn_loss": 0.08733620494604111,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.013148113733506783,
      "grad_norm": 0.5830205678939819,
      "learning_rate": 9.995412559116979e-06,
      "loss": 0.1303,
      "mae_dtheta": 0.008243544958531857,
      "mae_dx": 0.0016925374511629343,
      "mae_dy": 0.0018645277014002204,
      "pose_mae_dtheta": 0.05320101976394653,
      "pose_mae_dx": 0.019638005644083023,
      "pose_mae_dy": 0.026002025231719017,
      "pose_rmse_dtheta": 0.11507569253444672,
      "pose_rmse_dx": 0.0492827482521534,
      "pose_rmse_dy": 0.05578028783202171,
      "pose_rmse_mean": 0.07337957620620728,
      "rmse_dtheta": 0.017162853851914406,
      "rmse_dx": 0.005061691626906395,
      "rmse_dy": 0.003966702148318291,
      "rmse_mean": 0.008730416186153889,
      "rotation_flip": 0.005249343812465668,
      "sparse_tokens": 32089.0,
      "step": 283,
      "turn_loss": 0.0717242956161499,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.013194573499349563,
      "grad_norm": 0.4874153435230255,
      "learning_rate": 9.995355758040994e-06,
      "loss": 0.0957,
      "mae_dtheta": 0.013056711293756962,
      "mae_dx": 0.0024601712357252836,
      "mae_dy": 0.0036373066250234842,
      "pose_mae_dtheta": 0.09832640737295151,
      "pose_mae_dx": 0.0366661436855793,
      "pose_mae_dy": 0.04299361631274223,
      "pose_rmse_dtheta": 0.20744650065898895,
      "pose_rmse_dx": 0.09473866969347,
      "pose_rmse_dy": 0.10696286708116531,
      "pose_rmse_mean": 0.13638268411159515,
      "rmse_dtheta": 0.0252936203032732,
      "rmse_dx": 0.006539603229612112,
      "rmse_dy": 0.007698454428464174,
      "rmse_mean": 0.013177226297557354,
      "rotation_flip": 0.005565217230468988,
      "sparse_tokens": 32137.0,
      "step": 284,
      "turn_loss": 0.12588153779506683,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30077.0,
      "epoch": 0.013241033265192343,
      "grad_norm": 0.769242525100708,
      "learning_rate": 9.995298607637098e-06,
      "loss": 0.2275,
      "mae_dtheta": 0.04182345047593117,
      "mae_dx": 0.014519477263092995,
      "mae_dy": 0.006182193756103516,
      "pose_mae_dtheta": 0.3688683807849884,
      "pose_mae_dx": 0.11633338034152985,
      "pose_mae_dy": 0.07470236718654633,
      "pose_rmse_dtheta": 0.5798484086990356,
      "pose_rmse_dx": 0.23867733776569366,
      "pose_rmse_dy": 0.16811853647232056,
      "pose_rmse_mean": 0.3288814425468445,
      "rmse_dtheta": 0.05881758779287338,
      "rmse_dx": 0.026288045570254326,
      "rmse_dy": 0.01227547787129879,
      "rmse_mean": 0.032460372895002365,
      "rotation_flip": 0.012108261696994305,
      "sparse_tokens": 23206.0,
      "step": 285,
      "turn_loss": 0.33355528116226196,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 29431.0,
      "epoch": 0.013287493031035123,
      "grad_norm": 1.210158348083496,
      "learning_rate": 9.99524110790929e-06,
      "loss": 0.191,
      "mae_dtheta": 0.03273354470729828,
      "mae_dx": 0.019594412297010422,
      "mae_dy": 0.005658367648720741,
      "pose_mae_dtheta": 0.28256726264953613,
      "pose_mae_dx": 0.1830773800611496,
      "pose_mae_dy": 0.09781655669212341,
      "pose_rmse_dtheta": 0.5070634484291077,
      "pose_rmse_dx": 0.3667936325073242,
      "pose_rmse_dy": 0.19839239120483398,
      "pose_rmse_mean": 0.3574164807796478,
      "rmse_dtheta": 0.05053966864943504,
      "rmse_dx": 0.03531128168106079,
      "rmse_dy": 0.009864211082458496,
      "rmse_mean": 0.03190505504608154,
      "rotation_flip": 0.010362694039940834,
      "sparse_tokens": 22647.0,
      "step": 286,
      "turn_loss": 0.2812521457672119,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.013333952796877904,
      "grad_norm": 0.895039975643158,
      "learning_rate": 9.995183258861589e-06,
      "loss": 0.1674,
      "mae_dtheta": 0.016899552196264267,
      "mae_dx": 0.0024895858950912952,
      "mae_dy": 0.003054193686693907,
      "pose_mae_dtheta": 0.11696009337902069,
      "pose_mae_dx": 0.033725108951330185,
      "pose_mae_dy": 0.04206826910376549,
      "pose_rmse_dtheta": 0.2637535631656647,
      "pose_rmse_dx": 0.09273883700370789,
      "pose_rmse_dy": 0.09366744756698608,
      "pose_rmse_mean": 0.15005329251289368,
      "rmse_dtheta": 0.032270751893520355,
      "rmse_dx": 0.008065580390393734,
      "rmse_dy": 0.005889295134693384,
      "rmse_mean": 0.01540854386985302,
      "rotation_flip": 0.00997091829776764,
      "sparse_tokens": 32057.0,
      "step": 287,
      "turn_loss": 0.11372494697570801,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.013380412562720684,
      "grad_norm": 0.5064257383346558,
      "learning_rate": 9.995125060498043e-06,
      "loss": 0.1691,
      "mae_dtheta": 0.014035137370228767,
      "mae_dx": 0.0032172088976949453,
      "mae_dy": 0.002454061061143875,
      "pose_mae_dtheta": 0.10188189148902893,
      "pose_mae_dx": 0.03582047298550606,
      "pose_mae_dy": 0.03059171698987484,
      "pose_rmse_dtheta": 0.2551685571670532,
      "pose_rmse_dx": 0.08855114877223969,
      "pose_rmse_dy": 0.06957128643989563,
      "pose_rmse_mean": 0.13776367902755737,
      "rmse_dtheta": 0.030071767047047615,
      "rmse_dx": 0.008851666934788227,
      "rmse_dy": 0.005404395051300526,
      "rmse_mean": 0.014775943011045456,
      "rotation_flip": 0.0035335689317435026,
      "sparse_tokens": 32089.0,
      "step": 288,
      "turn_loss": 0.10358044505119324,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.013426872328563464,
      "grad_norm": 0.599253237247467,
      "learning_rate": 9.99506651282272e-06,
      "loss": 0.1289,
      "mae_dtheta": 0.026490982621908188,
      "mae_dx": 0.008514489978551865,
      "mae_dy": 0.004280210472643375,
      "pose_mae_dtheta": 0.18771477043628693,
      "pose_mae_dx": 0.06897018104791641,
      "pose_mae_dy": 0.04333680868148804,
      "pose_rmse_dtheta": 0.3797936737537384,
      "pose_rmse_dx": 0.13840597867965698,
      "pose_rmse_dy": 0.09441790729761124,
      "pose_rmse_mean": 0.20420587062835693,
      "rmse_dtheta": 0.04514903202652931,
      "rmse_dx": 0.01717109978199005,
      "rmse_dy": 0.008486681617796421,
      "rmse_mean": 0.02360227331519127,
      "rotation_flip": 0.007163323927670717,
      "sparse_tokens": 12013.0,
      "step": 289,
      "turn_loss": 0.2782512307167053,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.013473332094406244,
      "grad_norm": 0.7278510332107544,
      "learning_rate": 9.995007615839716e-06,
      "loss": 0.1635,
      "mae_dtheta": 0.014454133808612823,
      "mae_dx": 0.003359345020726323,
      "mae_dy": 0.0038172597996890545,
      "pose_mae_dtheta": 0.11609480530023575,
      "pose_mae_dx": 0.035695578902959824,
      "pose_mae_dy": 0.038169749081134796,
      "pose_rmse_dtheta": 0.33895304799079895,
      "pose_rmse_dx": 0.10492447018623352,
      "pose_rmse_dy": 0.15137512981891632,
      "pose_rmse_mean": 0.1984175443649292,
      "rmse_dtheta": 0.03520708903670311,
      "rmse_dx": 0.009948953986167908,
      "rmse_dy": 0.014540067873895168,
      "rmse_mean": 0.019898705184459686,
      "rotation_flip": 0.006040892098098993,
      "sparse_tokens": 32153.0,
      "step": 290,
      "turn_loss": 0.13603343069553375,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.013519791860249025,
      "grad_norm": 0.532119870185852,
      "learning_rate": 9.994948369553146e-06,
      "loss": 0.108,
      "mae_dtheta": 0.03350641205906868,
      "mae_dx": 0.011260267347097397,
      "mae_dy": 0.0032483572140336037,
      "pose_mae_dtheta": 0.27663320302963257,
      "pose_mae_dx": 0.11260023713111877,
      "pose_mae_dy": 0.03034454770386219,
      "pose_rmse_dtheta": 0.5944379568099976,
      "pose_rmse_dx": 0.28240448236465454,
      "pose_rmse_dy": 0.06453244388103485,
      "pose_rmse_mean": 0.3137916326522827,
      "rmse_dtheta": 0.057082973420619965,
      "rmse_dx": 0.024790778756141663,
      "rmse_dy": 0.005516263656318188,
      "rmse_mean": 0.029130004346370697,
      "rotation_flip": 0.005263158120214939,
      "sparse_tokens": 3800.0,
      "step": 291,
      "turn_loss": 0.2547149062156677,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.013566251626091805,
      "grad_norm": 1.3721445798873901,
      "learning_rate": 9.994888773967157e-06,
      "loss": 0.1817,
      "mae_dtheta": 0.03569550812244415,
      "mae_dx": 0.015497787855565548,
      "mae_dy": 0.005006907973438501,
      "pose_mae_dtheta": 0.30496904253959656,
      "pose_mae_dx": 0.1359075903892517,
      "pose_mae_dy": 0.06601699441671371,
      "pose_rmse_dtheta": 0.49948254227638245,
      "pose_rmse_dx": 0.2819938659667969,
      "pose_rmse_dy": 0.14591626822948456,
      "pose_rmse_mean": 0.3091309070587158,
      "rmse_dtheta": 0.051576707512140274,
      "rmse_dx": 0.028879456222057343,
      "rmse_dy": 0.009619922377169132,
      "rmse_mean": 0.030025362968444824,
      "rotation_flip": 0.014766201376914978,
      "sparse_tokens": 22174.0,
      "step": 292,
      "turn_loss": 0.3135637938976288,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.013612711391934585,
      "grad_norm": 0.5467761754989624,
      "learning_rate": 9.994828829085914e-06,
      "loss": 0.1321,
      "mae_dtheta": 0.022021310403943062,
      "mae_dx": 0.00925350934267044,
      "mae_dy": 0.002850788878276944,
      "pose_mae_dtheta": 0.18606163561344147,
      "pose_mae_dx": 0.08030720800161362,
      "pose_mae_dy": 0.04319913685321808,
      "pose_rmse_dtheta": 0.3638678193092346,
      "pose_rmse_dx": 0.19197843968868256,
      "pose_rmse_dy": 0.11123795062303543,
      "pose_rmse_mean": 0.22236141562461853,
      "rmse_dtheta": 0.038129959255456924,
      "rmse_dx": 0.02070562168955803,
      "rmse_dy": 0.005944710224866867,
      "rmse_mean": 0.021593432873487473,
      "rotation_flip": 0.008356546051800251,
      "sparse_tokens": 14946.0,
      "step": 293,
      "turn_loss": 0.13262873888015747,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.013659171157777365,
      "grad_norm": 0.6759242415428162,
      "learning_rate": 9.994768534913612e-06,
      "loss": 0.1453,
      "mae_dtheta": 0.006739137694239616,
      "mae_dx": 0.0015982954064384103,
      "mae_dy": 0.0006317151128314435,
      "pose_mae_dtheta": 0.05001315847039223,
      "pose_mae_dx": 0.014475613832473755,
      "pose_mae_dy": 0.011665749363601208,
      "pose_rmse_dtheta": 0.18625327944755554,
      "pose_rmse_dx": 0.041769854724407196,
      "pose_rmse_dy": 0.032441142946481705,
      "pose_rmse_mean": 0.08682142943143845,
      "rmse_dtheta": 0.023066595196723938,
      "rmse_dx": 0.005309144034981728,
      "rmse_dy": 0.001246653264388442,
      "rmse_mean": 0.0098741315305233,
      "rotation_flip": 0.001662510447204113,
      "sparse_tokens": 32089.0,
      "step": 294,
      "turn_loss": 0.040833570063114166,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.013705630923620146,
      "grad_norm": 0.7527183890342712,
      "learning_rate": 9.994707891454466e-06,
      "loss": 0.1626,
      "mae_dtheta": 0.04543864354491234,
      "mae_dx": 0.012909263372421265,
      "mae_dy": 0.004809717647731304,
      "pose_mae_dtheta": 0.39469975233078003,
      "pose_mae_dx": 0.10841961950063705,
      "pose_mae_dy": 0.043624233454465866,
      "pose_rmse_dtheta": 0.6697734594345093,
      "pose_rmse_dx": 0.20295314490795135,
      "pose_rmse_dy": 0.10742735117673874,
      "pose_rmse_mean": 0.3267180025577545,
      "rmse_dtheta": 0.06502947956323624,
      "rmse_dx": 0.0236599650233984,
      "rmse_dy": 0.0095302639529109,
      "rmse_mean": 0.03273990377783775,
      "rotation_flip": 0.018292682245373726,
      "sparse_tokens": 12506.0,
      "step": 295,
      "turn_loss": 0.3065229654312134,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.013752090689462926,
      "grad_norm": 0.6692384481430054,
      "learning_rate": 9.994646898712713e-06,
      "loss": 0.1555,
      "mae_dtheta": 0.0295269712805748,
      "mae_dx": 0.009709130972623825,
      "mae_dy": 0.003217131830751896,
      "pose_mae_dtheta": 0.22852620482444763,
      "pose_mae_dx": 0.07823742926120758,
      "pose_mae_dy": 0.03643885254859924,
      "pose_rmse_dtheta": 0.4755910336971283,
      "pose_rmse_dx": 0.1774466186761856,
      "pose_rmse_dy": 0.07881700247526169,
      "pose_rmse_mean": 0.24395155906677246,
      "rmse_dtheta": 0.04958074539899826,
      "rmse_dx": 0.02025425061583519,
      "rmse_dy": 0.005453689489513636,
      "rmse_mean": 0.0250962283462286,
      "rotation_flip": 0.023255813866853714,
      "sparse_tokens": 5782.0,
      "step": 296,
      "turn_loss": 0.14738251268863678,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.013798550455305706,
      "grad_norm": 0.6551541090011597,
      "learning_rate": 9.994585556692624e-06,
      "loss": 0.1139,
      "mae_dtheta": 0.03351680934429169,
      "mae_dx": 0.014983369037508965,
      "mae_dy": 0.008679674006998539,
      "pose_mae_dtheta": 0.25144705176353455,
      "pose_mae_dx": 0.11855249851942062,
      "pose_mae_dy": 0.10827793926000595,
      "pose_rmse_dtheta": 0.4196470379829407,
      "pose_rmse_dx": 0.3153689205646515,
      "pose_rmse_dy": 0.2464313805103302,
      "pose_rmse_mean": 0.3271491229534149,
      "rmse_dtheta": 0.04891365021467209,
      "rmse_dx": 0.03108322061598301,
      "rmse_dy": 0.019374169409275055,
      "rmse_mean": 0.033123679459095,
      "rotation_flip": 0.01759999990463257,
      "sparse_tokens": 11004.0,
      "step": 297,
      "turn_loss": 0.34524276852607727,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 34388.0,
      "epoch": 0.013845010221148485,
      "grad_norm": 0.6950433254241943,
      "learning_rate": 9.994523865398485e-06,
      "loss": 0.1559,
      "mae_dtheta": 0.029262550175189972,
      "mae_dx": 0.01118698250502348,
      "mae_dy": 0.004090971313416958,
      "pose_mae_dtheta": 0.22573217749595642,
      "pose_mae_dx": 0.09326351433992386,
      "pose_mae_dy": 0.051454655826091766,
      "pose_rmse_dtheta": 0.40559089183807373,
      "pose_rmse_dx": 0.22570735216140747,
      "pose_rmse_dy": 0.121139757335186,
      "pose_rmse_mean": 0.25081267952919006,
      "rmse_dtheta": 0.04505187273025513,
      "rmse_dx": 0.02415165863931179,
      "rmse_dy": 0.008654650300741196,
      "rmse_mean": 0.02595272660255432,
      "rotation_flip": 0.011082137934863567,
      "sparse_tokens": 26825.0,
      "step": 298,
      "turn_loss": 0.2592639923095703,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 17160.0,
      "epoch": 0.013891469986991265,
      "grad_norm": 0.4411255717277527,
      "learning_rate": 9.994461824834611e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.03518107905983925,
      "mae_dx": 0.014498845674097538,
      "mae_dy": 0.004816416651010513,
      "pose_mae_dtheta": 0.29583093523979187,
      "pose_mae_dx": 0.12185554206371307,
      "pose_mae_dy": 0.05943359434604645,
      "pose_rmse_dtheta": 0.4714758098125458,
      "pose_rmse_dx": 0.25259238481521606,
      "pose_rmse_dy": 0.1469821333885193,
      "pose_rmse_mean": 0.2903501093387604,
      "rmse_dtheta": 0.05106385797262192,
      "rmse_dx": 0.027659259736537933,
      "rmse_dy": 0.00944270845502615,
      "rmse_mean": 0.029388610273599625,
      "rotation_flip": 0.015521064400672913,
      "sparse_tokens": 14135.0,
      "step": 299,
      "turn_loss": 0.3224751055240631,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.013937929752834045,
      "grad_norm": 0.7339680790901184,
      "learning_rate": 9.994399435005343e-06,
      "loss": 0.1475,
      "mae_dtheta": 0.037031590938568115,
      "mae_dx": 0.01901550404727459,
      "mae_dy": 0.007640101946890354,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.733968198299408,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 106.64654541015625,
      "model/head/act_norm_mean": 88.01333279079861,
      "model/head/act_norm_min": 74.2293930053711,
      "model/head/act_over_embed": 60.48358628764063,
      "model/head/grad_frac": 0.09476622194051743,
      "model/head/grad_norm": 0.06955539435148239,
      "model/head/grad_zero_frac": 0.00016022224735934287,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6759982638888888,
      "model/head/update_ratio": 0.0012183170765638351,
      "model/head/weight_delta": 1.975388765335083,
      "model/head/weight_delta_rel": 0.0346541702747345,
      "model/head/weight_norm": 57.091373443603516,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4093039631843567,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4093039631843567,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4093039631843567,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28127751546436686,
      "model/modality_embedder.encoders.pose/grad_frac": 0.13759745657444,
      "model/modality_embedder.encoders.pose/grad_norm": 0.10099215805530548,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0032973624765872955,
      "model/modality_embedder.encoders.pose/weight_delta": 0.5650301575660706,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.01846129633486271,
      "model/modality_embedder.encoders.pose/weight_norm": 30.628164291381836,
      "model/modality_embedder/grad_frac": 0.13759745657444,
      "model/modality_embedder/grad_norm": 0.10099215805530548,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0032973624765872955,
      "model/modality_embedder/weight_delta": 0.5650301575660706,
      "model/modality_embedder/weight_delta_rel": 0.01846129633486271,
      "model/modality_embedder/weight_norm": 30.628164291381836,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 55.92317581176758,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.08181423611111,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.012380599975586,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.487620114110065,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07564816623926163,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0555233508348465,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020219176076352596,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.2445228397846222,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.008910560049116611,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.460737228393555,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 57.470855712890625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.006241732804234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.453892707824707,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.12289534446416,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0786980390548706,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05776185914874077,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001998193096369505,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.27115947008132935,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.009393176063895226,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.907045364379883,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 58.95121383666992,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 23.72145922894621,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.095194816589355,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.301608865932124,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0950348898768425,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06975258886814117,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002338855993002653,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.26694029569625854,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.008963354863226414,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.823379516601562,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 59.69647216796875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 25.829149787808642,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.250612258911133,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 17.75003355049229,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10200900584459305,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07487136870622635,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002556078601628542,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.22236818075180054,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.00759948929771781,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.29149627685547,
      "model/normalizer/grad_frac": 0.37791526317596436,
      "model/normalizer/grad_norm": 0.27737778425216675,
      "model/normalizer/grad_zero_frac": 0.00015953468391671777,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003570485394448042,
      "model/normalizer/weight_delta": 0.5202023983001709,
      "model/normalizer/weight_delta_rel": 0.006699905730783939,
      "model/normalizer/weight_norm": 77.68629455566406,
      "pose_mae_dtheta": 0.3211914002895355,
      "pose_mae_dx": 0.14821569621562958,
      "pose_mae_dy": 0.08544962108135223,
      "pose_rmse_dtheta": 0.5269103646278381,
      "pose_rmse_dx": 0.29114460945129395,
      "pose_rmse_dy": 0.18501605093479156,
      "pose_rmse_mean": 0.33435702323913574,
      "rmse_dtheta": 0.05468065291643143,
      "rmse_dx": 0.03288624435663223,
      "rmse_dy": 0.013847746886312962,
      "rmse_mean": 0.03380488231778145,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 9744.0,
      "step": 300,
      "turn_loss": 0.32034024596214294,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 1980.0,
      "epoch": 0.013984389518676825,
      "grad_norm": 0.5204473733901978,
      "learning_rate": 9.994336695915041e-06,
      "loss": 0.0947,
      "mae_dtheta": 0.04868074506521225,
      "mae_dx": 0.031719498336315155,
      "mae_dy": 0.013089715503156185,
      "pose_mae_dtheta": 0.3325974941253662,
      "pose_mae_dx": 0.22473454475402832,
      "pose_mae_dy": 0.26511409878730774,
      "pose_rmse_dtheta": 0.44869738817214966,
      "pose_rmse_dx": 0.3391266465187073,
      "pose_rmse_dy": 0.39419859647750854,
      "pose_rmse_mean": 0.39400753378868103,
      "rmse_dtheta": 0.06157238036394119,
      "rmse_dx": 0.04508889466524124,
      "rmse_dy": 0.015761489048600197,
      "rmse_mean": 0.04080758988857269,
      "rotation_flip": 0.01923076994717121,
      "sparse_tokens": 1713.0,
      "step": 301,
      "turn_loss": 0.3788205087184906,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.014030849284519606,
      "grad_norm": 0.5100350379943848,
      "learning_rate": 9.994273607568093e-06,
      "loss": 0.1439,
      "mae_dtheta": 0.009441562928259373,
      "mae_dx": 0.0016800767043605447,
      "mae_dy": 0.0023052478209137917,
      "pose_mae_dtheta": 0.06930975615978241,
      "pose_mae_dx": 0.026027636602520943,
      "pose_mae_dy": 0.030590439215302467,
      "pose_rmse_dtheta": 0.18048079311847687,
      "pose_rmse_dx": 0.06853663921356201,
      "pose_rmse_dy": 0.08205299824476242,
      "pose_rmse_mean": 0.11035680770874023,
      "rmse_dtheta": 0.022136321291327477,
      "rmse_dx": 0.005286410916596651,
      "rmse_dy": 0.005273045971989632,
      "rmse_mean": 0.010898592881858349,
      "rotation_flip": 0.003036876441910863,
      "sparse_tokens": 32057.0,
      "step": 302,
      "turn_loss": 0.07354272156953812,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.014077309050362386,
      "grad_norm": 0.9324755668640137,
      "learning_rate": 9.994210169968912e-06,
      "loss": 0.3115,
      "mae_dtheta": 0.03804096579551697,
      "mae_dx": 0.013065776787698269,
      "mae_dy": 0.004590988624840975,
      "pose_mae_dtheta": 0.3187345564365387,
      "pose_mae_dx": 0.11301453411579132,
      "pose_mae_dy": 0.06923545151948929,
      "pose_rmse_dtheta": 0.5679420232772827,
      "pose_rmse_dx": 0.24735219776630402,
      "pose_rmse_dy": 0.13180547952651978,
      "pose_rmse_mean": 0.31569990515708923,
      "rmse_dtheta": 0.05845677852630615,
      "rmse_dx": 0.026484638452529907,
      "rmse_dy": 0.007793658412992954,
      "rmse_mean": 0.03091169148683548,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 21250.0,
      "step": 303,
      "turn_loss": 0.2636743187904358,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.014123768816205166,
      "grad_norm": 0.5146932005882263,
      "learning_rate": 9.99414638312193e-06,
      "loss": 0.1417,
      "mae_dtheta": 0.010236972011625767,
      "mae_dx": 0.0023427174892276525,
      "mae_dy": 0.0029192392248660326,
      "pose_mae_dtheta": 0.07687915116548538,
      "pose_mae_dx": 0.029272466897964478,
      "pose_mae_dy": 0.03193065524101257,
      "pose_rmse_dtheta": 0.15728405117988586,
      "pose_rmse_dx": 0.0776260644197464,
      "pose_rmse_dy": 0.07055078446865082,
      "pose_rmse_mean": 0.10182030498981476,
      "rmse_dtheta": 0.022014468908309937,
      "rmse_dx": 0.007121797185391188,
      "rmse_dy": 0.0072657461278140545,
      "rmse_mean": 0.012134004384279251,
      "rotation_flip": 0.0025916327722370625,
      "sparse_tokens": 32121.0,
      "step": 304,
      "turn_loss": 0.09544560313224792,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.014170228582047946,
      "grad_norm": 0.5242128372192383,
      "learning_rate": 9.994082247031613e-06,
      "loss": 0.1574,
      "mae_dtheta": 0.012442287057638168,
      "mae_dx": 0.0030110152438282967,
      "mae_dy": 0.00272562587633729,
      "pose_mae_dtheta": 0.0947171077132225,
      "pose_mae_dx": 0.038664694875478745,
      "pose_mae_dy": 0.03653421625494957,
      "pose_rmse_dtheta": 0.2718009352684021,
      "pose_rmse_dx": 0.11316345632076263,
      "pose_rmse_dy": 0.11032969504594803,
      "pose_rmse_mean": 0.16509804129600525,
      "rmse_dtheta": 0.030011367052793503,
      "rmse_dx": 0.009129384532570839,
      "rmse_dy": 0.008370493538677692,
      "rmse_mean": 0.015837082639336586,
      "rotation_flip": 0.003560529090464115,
      "sparse_tokens": 32089.0,
      "step": 305,
      "turn_loss": 0.10531402379274368,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.014216688347890727,
      "grad_norm": 0.4868175685405731,
      "learning_rate": 9.994017761702446e-06,
      "loss": 0.1445,
      "mae_dtheta": 0.014380184933543205,
      "mae_dx": 0.003044459968805313,
      "mae_dy": 0.003151949029415846,
      "pose_mae_dtheta": 0.10785359144210815,
      "pose_mae_dx": 0.039276737719774246,
      "pose_mae_dy": 0.03809367120265961,
      "pose_rmse_dtheta": 0.26041334867477417,
      "pose_rmse_dx": 0.09494727849960327,
      "pose_rmse_dy": 0.09437248855829239,
      "pose_rmse_mean": 0.1499110460281372,
      "rmse_dtheta": 0.02997775748372078,
      "rmse_dx": 0.008446014486253262,
      "rmse_dy": 0.007352133747190237,
      "rmse_mean": 0.015258635394275188,
      "rotation_flip": 0.006575857289135456,
      "sparse_tokens": 32105.0,
      "step": 306,
      "turn_loss": 0.11787402629852295,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.014263148113733507,
      "grad_norm": 0.6153587102890015,
      "learning_rate": 9.993952927138933e-06,
      "loss": 0.1473,
      "mae_dtheta": 0.016615750268101692,
      "mae_dx": 0.004293247126042843,
      "mae_dy": 0.004477497190237045,
      "pose_mae_dtheta": 0.1199759840965271,
      "pose_mae_dx": 0.04875192791223526,
      "pose_mae_dy": 0.060085296630859375,
      "pose_rmse_dtheta": 0.2513726055622101,
      "pose_rmse_dx": 0.1361253261566162,
      "pose_rmse_dy": 0.14770084619522095,
      "pose_rmse_mean": 0.17839960753917694,
      "rmse_dtheta": 0.03053903952240944,
      "rmse_dx": 0.013769430108368397,
      "rmse_dy": 0.01042150054126978,
      "rmse_mean": 0.018243324011564255,
      "rotation_flip": 0.009952082298696041,
      "sparse_tokens": 32105.0,
      "step": 307,
      "turn_loss": 0.15824469923973083,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.014309607879576287,
      "grad_norm": 0.652741014957428,
      "learning_rate": 9.993887743345613e-06,
      "loss": 0.2342,
      "mae_dtheta": 0.03344663605093956,
      "mae_dx": 0.011080853641033173,
      "mae_dy": 0.006032729521393776,
      "pose_mae_dtheta": 0.264373242855072,
      "pose_mae_dx": 0.10017824918031693,
      "pose_mae_dy": 0.0775744691491127,
      "pose_rmse_dtheta": 0.45097967982292175,
      "pose_rmse_dx": 0.2338893562555313,
      "pose_rmse_dy": 0.16032038629055023,
      "pose_rmse_mean": 0.2817298173904419,
      "rmse_dtheta": 0.05018157511949539,
      "rmse_dx": 0.02315611205995083,
      "rmse_dy": 0.01158140879124403,
      "rmse_mean": 0.02830636501312256,
      "rotation_flip": 0.012367491610348225,
      "sparse_tokens": 18598.0,
      "step": 308,
      "turn_loss": 0.2926079034805298,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.014356067645419067,
      "grad_norm": 0.5188194513320923,
      "learning_rate": 9.993822210327043e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.013925223611295223,
      "mae_dx": 0.0032047939021140337,
      "mae_dy": 0.003141633700579405,
      "pose_mae_dtheta": 0.10278242826461792,
      "pose_mae_dx": 0.04321166127920151,
      "pose_mae_dy": 0.0404057577252388,
      "pose_rmse_dtheta": 0.24130626022815704,
      "pose_rmse_dx": 0.10079445689916611,
      "pose_rmse_dy": 0.08550205826759338,
      "pose_rmse_mean": 0.1425342559814453,
      "rmse_dtheta": 0.028680214658379555,
      "rmse_dx": 0.008873400278389454,
      "rmse_dy": 0.007018290460109711,
      "rmse_mean": 0.01485730241984129,
      "rotation_flip": 0.003606853075325489,
      "sparse_tokens": 32073.0,
      "step": 309,
      "turn_loss": 0.10976731777191162,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33634.0,
      "epoch": 0.014402527411261848,
      "grad_norm": 0.39271435141563416,
      "learning_rate": 9.993756328087806e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.04195774719119072,
      "mae_dx": 0.012858257628977299,
      "mae_dy": 0.003370841033756733,
      "pose_mae_dtheta": 0.36128950119018555,
      "pose_mae_dx": 0.1107083261013031,
      "pose_mae_dy": 0.03380937874317169,
      "pose_rmse_dtheta": 0.6159018278121948,
      "pose_rmse_dx": 0.22666944563388824,
      "pose_rmse_dy": 0.07548706978559494,
      "pose_rmse_mean": 0.30601945519447327,
      "rmse_dtheta": 0.06109488010406494,
      "rmse_dx": 0.023801395669579506,
      "rmse_dy": 0.0066487607546150684,
      "rmse_mean": 0.03051501326262951,
      "rotation_flip": 0.013341804035007954,
      "sparse_tokens": 26777.0,
      "step": 310,
      "turn_loss": 0.3187310993671417,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.014448987177104628,
      "grad_norm": 0.71202152967453,
      "learning_rate": 9.993690096632507e-06,
      "loss": 0.1625,
      "mae_dtheta": 0.05710998922586441,
      "mae_dx": 0.011395644396543503,
      "mae_dy": 0.005615219473838806,
      "pose_mae_dtheta": 0.47701239585876465,
      "pose_mae_dx": 0.10432698577642441,
      "pose_mae_dy": 0.08799007534980774,
      "pose_rmse_dtheta": 0.7350404262542725,
      "pose_rmse_dx": 0.210500568151474,
      "pose_rmse_dy": 0.17276035249233246,
      "pose_rmse_mean": 0.3727671504020691,
      "rmse_dtheta": 0.07683340460062027,
      "rmse_dx": 0.02316085807979107,
      "rmse_dy": 0.011254891753196716,
      "rmse_mean": 0.03708305209875107,
      "rotation_flip": 0.0211267601698637,
      "sparse_tokens": 2259.0,
      "step": 311,
      "turn_loss": 0.29674121737480164,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.014495446942947408,
      "grad_norm": 0.42487475275993347,
      "learning_rate": 9.99362351596578e-06,
      "loss": 0.1001,
      "mae_dtheta": 0.036114081740379333,
      "mae_dx": 0.012735416181385517,
      "mae_dy": 0.006432408932596445,
      "pose_mae_dtheta": 0.27627405524253845,
      "pose_mae_dx": 0.08281105011701584,
      "pose_mae_dy": 0.06870302557945251,
      "pose_rmse_dtheta": 0.48275226354599,
      "pose_rmse_dx": 0.147157683968544,
      "pose_rmse_dy": 0.16180704534053802,
      "pose_rmse_mean": 0.26390567421913147,
      "rmse_dtheta": 0.0556710883975029,
      "rmse_dx": 0.022623248398303986,
      "rmse_dy": 0.015167642384767532,
      "rmse_mean": 0.03115399181842804,
      "rotation_flip": 0.009756097570061684,
      "sparse_tokens": 7129.0,
      "step": 312,
      "turn_loss": 0.3390132486820221,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.014541906708790188,
      "grad_norm": 0.4594400227069855,
      "learning_rate": 9.993556586092281e-06,
      "loss": 0.1666,
      "mae_dtheta": 0.014052024111151695,
      "mae_dx": 0.0031523362267762423,
      "mae_dy": 0.0036574339028447866,
      "pose_mae_dtheta": 0.11559101939201355,
      "pose_mae_dx": 0.033243242651224136,
      "pose_mae_dy": 0.04880787804722786,
      "pose_rmse_dtheta": 0.23268276453018188,
      "pose_rmse_dx": 0.0836496502161026,
      "pose_rmse_dy": 0.12748996913433075,
      "pose_rmse_mean": 0.14794079959392548,
      "rmse_dtheta": 0.026799602434039116,
      "rmse_dx": 0.00939050130546093,
      "rmse_dy": 0.009307519532740116,
      "rmse_mean": 0.015165874734520912,
      "rotation_flip": 0.011996572837233543,
      "sparse_tokens": 32089.0,
      "step": 313,
      "turn_loss": 0.11639822274446487,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.014588366474632969,
      "grad_norm": 0.48917993903160095,
      "learning_rate": 9.993489307016689e-06,
      "loss": 0.1365,
      "mae_dtheta": 0.036437492817640305,
      "mae_dx": 0.018725823611021042,
      "mae_dy": 0.007165607996284962,
      "pose_mae_dtheta": 0.28548404574394226,
      "pose_mae_dx": 0.16287556290626526,
      "pose_mae_dy": 0.09623561799526215,
      "pose_rmse_dtheta": 0.4704624116420746,
      "pose_rmse_dx": 0.31628549098968506,
      "pose_rmse_dy": 0.19922371208667755,
      "pose_rmse_mean": 0.32865720987319946,
      "rmse_dtheta": 0.051382243633270264,
      "rmse_dx": 0.03264893591403961,
      "rmse_dy": 0.012776723131537437,
      "rmse_mean": 0.032269302755594254,
      "rotation_flip": 0.009443861432373524,
      "sparse_tokens": 17160.0,
      "step": 314,
      "turn_loss": 0.3748006522655487,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.014634826240475749,
      "grad_norm": 0.37261781096458435,
      "learning_rate": 9.993421678743708e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.06819074600934982,
      "mae_dx": 0.023495828732848167,
      "mae_dy": 0.01610749401152134,
      "pose_mae_dtheta": 0.5837344527244568,
      "pose_mae_dx": 0.17737986147403717,
      "pose_mae_dy": 0.15845808386802673,
      "pose_rmse_dtheta": 0.8981698751449585,
      "pose_rmse_dx": 0.3617415130138397,
      "pose_rmse_dy": 0.39297419786453247,
      "pose_rmse_mean": 0.5509619116783142,
      "rmse_dtheta": 0.08546611666679382,
      "rmse_dx": 0.03632345050573349,
      "rmse_dy": 0.0307016484439373,
      "rmse_mean": 0.050830405205488205,
      "rotation_flip": 0.012987012974917889,
      "sparse_tokens": 2934.0,
      "step": 315,
      "turn_loss": 0.5467778444290161,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.014681286006318527,
      "grad_norm": 0.4576599895954132,
      "learning_rate": 9.993353701278072e-06,
      "loss": 0.0837,
      "mae_dtheta": 0.009915032424032688,
      "mae_dx": 0.0021639384794980288,
      "mae_dy": 0.002245175652205944,
      "pose_mae_dtheta": 0.07202891260385513,
      "pose_mae_dx": 0.025573229417204857,
      "pose_mae_dy": 0.030241871252655983,
      "pose_rmse_dtheta": 0.16650806367397308,
      "pose_rmse_dx": 0.06589394807815552,
      "pose_rmse_dy": 0.0911526009440422,
      "pose_rmse_mean": 0.1078515350818634,
      "rmse_dtheta": 0.022550096735358238,
      "rmse_dx": 0.005878862924873829,
      "rmse_dy": 0.005277569871395826,
      "rmse_mean": 0.011235510930418968,
      "rotation_flip": 0.004619907587766647,
      "sparse_tokens": 32185.0,
      "step": 316,
      "turn_loss": 0.09485510736703873,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17859.0,
      "epoch": 0.014727745772161308,
      "grad_norm": 0.5975137948989868,
      "learning_rate": 9.993285374624531e-06,
      "loss": 0.1457,
      "mae_dtheta": 0.027444161474704742,
      "mae_dx": 0.01071805041283369,
      "mae_dy": 0.004396046511828899,
      "pose_mae_dtheta": 0.19772972166538239,
      "pose_mae_dx": 0.09771625697612762,
      "pose_mae_dy": 0.05768008530139923,
      "pose_rmse_dtheta": 0.3327591121196747,
      "pose_rmse_dx": 0.24504703283309937,
      "pose_rmse_dy": 0.11559273302555084,
      "pose_rmse_mean": 0.23113295435905457,
      "rmse_dtheta": 0.04277632385492325,
      "rmse_dx": 0.024541320279240608,
      "rmse_dy": 0.007766103371977806,
      "rmse_mean": 0.025027915835380554,
      "rotation_flip": 0.0037406482733786106,
      "sparse_tokens": 15085.0,
      "step": 317,
      "turn_loss": 0.25323233008384705,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.014774205538004088,
      "grad_norm": 0.42916637659072876,
      "learning_rate": 9.993216698787861e-06,
      "loss": 0.1941,
      "mae_dtheta": 0.03607841953635216,
      "mae_dx": 0.01556459255516529,
      "mae_dy": 0.005856737028807402,
      "pose_mae_dtheta": 0.26106393337249756,
      "pose_mae_dx": 0.11636693775653839,
      "pose_mae_dy": 0.07368814200162888,
      "pose_rmse_dtheta": 0.4415358901023865,
      "pose_rmse_dx": 0.2378310263156891,
      "pose_rmse_dy": 0.15061618387699127,
      "pose_rmse_mean": 0.2766610383987427,
      "rmse_dtheta": 0.05249519646167755,
      "rmse_dx": 0.02814551815390587,
      "rmse_dy": 0.01082732155919075,
      "rmse_mean": 0.030489346012473106,
      "rotation_flip": 0.019195612519979477,
      "sparse_tokens": 17698.0,
      "step": 318,
      "turn_loss": 0.32437267899513245,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.014820665303846868,
      "grad_norm": 0.4419581890106201,
      "learning_rate": 9.993147673772869e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.007962744683027267,
      "mae_dx": 0.0026409488637000322,
      "mae_dy": 0.0015735540073364973,
      "pose_mae_dtheta": 0.05920359492301941,
      "pose_mae_dx": 0.025206195190548897,
      "pose_mae_dy": 0.020292237401008606,
      "pose_rmse_dtheta": 0.16156001389026642,
      "pose_rmse_dx": 0.06595984846353531,
      "pose_rmse_dy": 0.054575707763433456,
      "pose_rmse_mean": 0.09403186291456223,
      "rmse_dtheta": 0.02054451033473015,
      "rmse_dx": 0.007494673598557711,
      "rmse_dy": 0.004406836349517107,
      "rmse_mean": 0.010815340094268322,
      "rotation_flip": 0.003206412773579359,
      "sparse_tokens": 32185.0,
      "step": 319,
      "turn_loss": 0.08551321923732758,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.014867125069689648,
      "grad_norm": 0.5613313317298889,
      "learning_rate": 9.993078299584382e-06,
      "loss": 0.1507,
      "mae_dtheta": 0.016457732766866684,
      "mae_dx": 0.003946754150092602,
      "mae_dy": 0.005352759268134832,
      "pose_mae_dtheta": 0.1212099939584732,
      "pose_mae_dx": 0.04946431145071983,
      "pose_mae_dy": 0.05357280373573303,
      "pose_rmse_dtheta": 0.2545112073421478,
      "pose_rmse_dx": 0.13658058643341064,
      "pose_rmse_dy": 0.14301177859306335,
      "pose_rmse_mean": 0.17803452908992767,
      "rmse_dtheta": 0.030488146468997,
      "rmse_dx": 0.01137490849941969,
      "rmse_dy": 0.012320460751652718,
      "rmse_mean": 0.01806117221713066,
      "rotation_flip": 0.00844594556838274,
      "sparse_tokens": 32073.0,
      "step": 320,
      "turn_loss": 0.15879933536052704,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.014913584835532429,
      "grad_norm": 0.7453016042709351,
      "learning_rate": 9.993008576227248e-06,
      "loss": 0.2217,
      "mae_dtheta": 0.01902710646390915,
      "mae_dx": 0.00417747488245368,
      "mae_dy": 0.004390857182443142,
      "pose_mae_dtheta": 0.12798605859279633,
      "pose_mae_dx": 0.04872633516788483,
      "pose_mae_dy": 0.04834325239062309,
      "pose_rmse_dtheta": 0.27232444286346436,
      "pose_rmse_dx": 0.1116393506526947,
      "pose_rmse_dy": 0.0998258963227272,
      "pose_rmse_mean": 0.16126322746276855,
      "rmse_dtheta": 0.03433748334646225,
      "rmse_dx": 0.010834426619112492,
      "rmse_dy": 0.008440189063549042,
      "rmse_mean": 0.017870699986815453,
      "rotation_flip": 0.006849315017461777,
      "sparse_tokens": 32153.0,
      "step": 321,
      "turn_loss": 0.16636089980602264,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.014960044601375209,
      "grad_norm": 0.8609315752983093,
      "learning_rate": 9.992938503706343e-06,
      "loss": 0.1069,
      "mae_dtheta": 0.012807353399693966,
      "mae_dx": 0.003760767402127385,
      "mae_dy": 0.0035215113312005997,
      "pose_mae_dtheta": 0.08616145700216293,
      "pose_mae_dx": 0.04501312971115112,
      "pose_mae_dy": 0.03971453011035919,
      "pose_rmse_dtheta": 0.1626002937555313,
      "pose_rmse_dx": 0.11960913985967636,
      "pose_rmse_dy": 0.08559003472328186,
      "pose_rmse_mean": 0.12259982526302338,
      "rmse_dtheta": 0.024329807609319687,
      "rmse_dx": 0.011411543004214764,
      "rmse_dy": 0.007833435200154781,
      "rmse_mean": 0.014524929225444794,
      "rotation_flip": 0.009349155239760876,
      "sparse_tokens": 32105.0,
      "step": 322,
      "turn_loss": 0.14227618277072906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.015006504367217989,
      "grad_norm": 0.7566431760787964,
      "learning_rate": 9.99286808202657e-06,
      "loss": 0.2331,
      "mae_dtheta": 0.03713546320796013,
      "mae_dx": 0.010290929116308689,
      "mae_dy": 0.005894628819078207,
      "pose_mae_dtheta": 0.28417646884918213,
      "pose_mae_dx": 0.07784965634346008,
      "pose_mae_dy": 0.07139892876148224,
      "pose_rmse_dtheta": 0.47334861755371094,
      "pose_rmse_dx": 0.1938319206237793,
      "pose_rmse_dy": 0.15535125136375427,
      "pose_rmse_mean": 0.27417728304862976,
      "rmse_dtheta": 0.05303444340825081,
      "rmse_dx": 0.022774668410420418,
      "rmse_dy": 0.010944347828626633,
      "rmse_mean": 0.028917819261550903,
      "rotation_flip": 0.007215007208287716,
      "sparse_tokens": 10774.0,
      "step": 323,
      "turn_loss": 0.292233943939209,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.01505296413306077,
      "grad_norm": 0.7813586592674255,
      "learning_rate": 9.992797311192853e-06,
      "loss": 0.1877,
      "mae_dtheta": 0.02279399335384369,
      "mae_dx": 0.007371311541646719,
      "mae_dy": 0.0073027946054935455,
      "pose_mae_dtheta": 0.16639268398284912,
      "pose_mae_dx": 0.07839668542146683,
      "pose_mae_dy": 0.07339737564325333,
      "pose_rmse_dtheta": 0.3411954343318939,
      "pose_rmse_dx": 0.19893181324005127,
      "pose_rmse_dy": 0.1623348593711853,
      "pose_rmse_mean": 0.23415404558181763,
      "rmse_dtheta": 0.03952042758464813,
      "rmse_dx": 0.01722864620387554,
      "rmse_dy": 0.014713543467223644,
      "rmse_mean": 0.023820873349905014,
      "rotation_flip": 0.015394088812172413,
      "sparse_tokens": 32121.0,
      "step": 324,
      "turn_loss": 0.22778861224651337,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.01509942389890355,
      "grad_norm": 0.5712491273880005,
      "learning_rate": 9.992726191210139e-06,
      "loss": 0.1393,
      "mae_dtheta": 0.010237644426524639,
      "mae_dx": 0.0023710380773991346,
      "mae_dy": 0.0020437329076230526,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5712490081787109,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 146.2073516845703,
      "model/head/act_norm_mean": 117.36454387626263,
      "model/head/act_norm_min": 70.52364349365234,
      "model/head/act_over_embed": 80.65401333593907,
      "model/head/grad_frac": 0.12016063183546066,
      "model/head/grad_norm": 0.06864164024591446,
      "model/head/grad_zero_frac": 0.0001662504073465243,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6818428424873737,
      "model/head/update_ratio": 0.001202134182676673,
      "model/head/weight_delta": 2.0428266525268555,
      "model/head/weight_delta_rel": 0.03583722934126854,
      "model/head/weight_norm": 57.099815368652344,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4095025956630707,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4094446293441704,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4093822240829468,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2813741825663282,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08131665736436844,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04645206034183502,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5354190022421524,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015165782533586025,
      "model/modality_embedder.encoders.pose/weight_delta": 0.5728886723518372,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.018718058243393898,
      "model/modality_embedder.encoders.pose/weight_norm": 30.6295166015625,
      "model/modality_embedder/grad_frac": 0.08131665736436844,
      "model/modality_embedder/grad_norm": 0.04645206034183502,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5354190022421524,
      "model/modality_embedder/update_ratio": 0.0015165782533586025,
      "model/modality_embedder/weight_delta": 0.5728886723518372,
      "model/modality_embedder/weight_delta_rel": 0.018718058243393898,
      "model/modality_embedder/weight_norm": 30.6295166015625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.23466491699219,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.891336479878145,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.916348457336426,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.41835010318843,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09996869415044785,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05710701644420624,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002079407451674342,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.25614574551582336,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.009334105998277664,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.463119506835938,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.67078399658203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.952811848645183,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.215617179870605,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.147805914294114,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09828612953424454,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05614585429430008,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001942027942277491,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.2836192548274994,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.009824792854487896,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.910940170288086,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.49978637695312,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.835635622093957,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.332282066345215,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.441700038682,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09698158502578735,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.055400632321834564,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018573652487248182,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.27975398302078247,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.00939361471682787,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.827537536621094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.3470458984375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.66951759660093,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.359676361083984,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.701960900636738,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10280308127403259,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05872615799307823,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020047109574079514,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.2311764508485794,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.007900513708591461,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.294078826904297,
      "model/normalizer/grad_frac": 0.3645790219306946,
      "model/normalizer/grad_norm": 0.20826540887355804,
      "model/normalizer/grad_zero_frac": 0.00018671466386877,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002680704463273287,
      "model/normalizer/weight_delta": 0.5440369844436646,
      "model/normalizer/weight_delta_rel": 0.007006881292909384,
      "model/normalizer/weight_norm": 77.6905517578125,
      "pose_mae_dtheta": 0.0799190029501915,
      "pose_mae_dx": 0.026536377146840096,
      "pose_mae_dy": 0.031420789659023285,
      "pose_rmse_dtheta": 0.2047797590494156,
      "pose_rmse_dx": 0.07213891297578812,
      "pose_rmse_dy": 0.0893087089061737,
      "pose_rmse_mean": 0.12207579612731934,
      "rmse_dtheta": 0.024860622361302376,
      "rmse_dx": 0.007069940213114023,
      "rmse_dy": 0.005494460463523865,
      "rmse_mean": 0.012475008144974709,
      "rotation_flip": 0.0038759689778089523,
      "sparse_tokens": 32105.0,
      "step": 325,
      "turn_loss": 0.07565714418888092,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.01514588366474633,
      "grad_norm": 0.7372612953186035,
      "learning_rate": 9.992654722083401e-06,
      "loss": 0.1844,
      "mae_dtheta": 0.037023723125457764,
      "mae_dx": 0.010457303375005722,
      "mae_dy": 0.0057610152289271355,
      "pose_mae_dtheta": 0.2693280577659607,
      "pose_mae_dx": 0.07808738201856613,
      "pose_mae_dy": 0.059156473726034164,
      "pose_rmse_dtheta": 0.5134654641151428,
      "pose_rmse_dx": 0.21214152872562408,
      "pose_rmse_dy": 0.1383005976676941,
      "pose_rmse_mean": 0.2879692018032074,
      "rmse_dtheta": 0.05776752158999443,
      "rmse_dx": 0.023216944187879562,
      "rmse_dy": 0.013090998865664005,
      "rmse_mean": 0.03135848790407181,
      "rotation_flip": 0.014475271105766296,
      "sparse_tokens": 15338.0,
      "step": 326,
      "turn_loss": 0.2201959788799286,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.01519234343058911,
      "grad_norm": 0.32933881878852844,
      "learning_rate": 9.99258290381764e-06,
      "loss": 0.0895,
      "mae_dtheta": 0.01082500908523798,
      "mae_dx": 0.001689643133431673,
      "mae_dy": 0.0025361108127981424,
      "pose_mae_dtheta": 0.07695017755031586,
      "pose_mae_dx": 0.02442672662436962,
      "pose_mae_dy": 0.033960387110710144,
      "pose_rmse_dtheta": 0.18920333683490753,
      "pose_rmse_dx": 0.060876864939928055,
      "pose_rmse_dy": 0.08834704756736755,
      "pose_rmse_mean": 0.11280908435583115,
      "rmse_dtheta": 0.02366277016699314,
      "rmse_dx": 0.005215267650783062,
      "rmse_dy": 0.005846670363098383,
      "rmse_mean": 0.011574903503060341,
      "rotation_flip": 0.004482294898480177,
      "sparse_tokens": 32073.0,
      "step": 327,
      "turn_loss": 0.08129582554101944,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.01523880319643189,
      "grad_norm": 0.36201146245002747,
      "learning_rate": 9.992510736417878e-06,
      "loss": 0.1335,
      "mae_dtheta": 0.013945688493549824,
      "mae_dx": 0.002892115619033575,
      "mae_dy": 0.001861209631897509,
      "pose_mae_dtheta": 0.10446726530790329,
      "pose_mae_dx": 0.028687989339232445,
      "pose_mae_dy": 0.030369721353054047,
      "pose_rmse_dtheta": 0.2449948936700821,
      "pose_rmse_dx": 0.06925484538078308,
      "pose_rmse_dy": 0.07673481851816177,
      "pose_rmse_mean": 0.1303281933069229,
      "rmse_dtheta": 0.029224349185824394,
      "rmse_dx": 0.008230425417423248,
      "rmse_dy": 0.003885954152792692,
      "rmse_mean": 0.013780243694782257,
      "rotation_flip": 0.0027434842195361853,
      "sparse_tokens": 32137.0,
      "step": 328,
      "turn_loss": 0.1053917407989502,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.01528526296227467,
      "grad_norm": 0.9295665621757507,
      "learning_rate": 9.99243821988916e-06,
      "loss": 0.2293,
      "mae_dtheta": 0.04652099311351776,
      "mae_dx": 0.017908181995153427,
      "mae_dy": 0.005246147513389587,
      "pose_mae_dtheta": 0.4128072261810303,
      "pose_mae_dx": 0.14553062617778778,
      "pose_mae_dy": 0.0822732076048851,
      "pose_rmse_dtheta": 0.6815267205238342,
      "pose_rmse_dx": 0.2837228775024414,
      "pose_rmse_dy": 0.20706398785114288,
      "pose_rmse_mean": 0.39077121019363403,
      "rmse_dtheta": 0.06752017885446548,
      "rmse_dx": 0.03144027665257454,
      "rmse_dy": 0.010838310234248638,
      "rmse_mean": 0.03659959137439728,
      "rotation_flip": 0.019089573994278908,
      "sparse_tokens": 11715.0,
      "step": 329,
      "turn_loss": 0.33380988240242004,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.01533172272811745,
      "grad_norm": 0.4155007302761078,
      "learning_rate": 9.992365354236557e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.0157365333288908,
      "mae_dx": 0.0027732725720852613,
      "mae_dy": 0.003177613951265812,
      "pose_mae_dtheta": 0.11292926967144012,
      "pose_mae_dx": 0.0299240555614233,
      "pose_mae_dy": 0.038310058414936066,
      "pose_rmse_dtheta": 0.24668119847774506,
      "pose_rmse_dx": 0.07526682317256927,
      "pose_rmse_dy": 0.0972239151597023,
      "pose_rmse_mean": 0.1397239863872528,
      "rmse_dtheta": 0.03085518069565296,
      "rmse_dx": 0.008317750878632069,
      "rmse_dy": 0.007723629474639893,
      "rmse_mean": 0.015632187947630882,
      "rotation_flip": 0.010412926785647869,
      "sparse_tokens": 32121.0,
      "step": 330,
      "turn_loss": 0.14838053286075592,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.015378182493960231,
      "grad_norm": 0.4869455397129059,
      "learning_rate": 9.992292139465166e-06,
      "loss": 0.1654,
      "mae_dtheta": 0.01499179471284151,
      "mae_dx": 0.003651314415037632,
      "mae_dy": 0.0030596861615777016,
      "pose_mae_dtheta": 0.1071944534778595,
      "pose_mae_dx": 0.03349053114652634,
      "pose_mae_dy": 0.033473361283540726,
      "pose_rmse_dtheta": 0.2587376832962036,
      "pose_rmse_dx": 0.08516750484704971,
      "pose_rmse_dy": 0.07644040882587433,
      "pose_rmse_mean": 0.14011520147323608,
      "rmse_dtheta": 0.030200572684407234,
      "rmse_dx": 0.010529138147830963,
      "rmse_dy": 0.007967354729771614,
      "rmse_mean": 0.016232354566454887,
      "rotation_flip": 0.005791505798697472,
      "sparse_tokens": 32153.0,
      "step": 331,
      "turn_loss": 0.1360040009021759,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.015424642259803011,
      "grad_norm": 0.9383793473243713,
      "learning_rate": 9.992218575580106e-06,
      "loss": 0.3032,
      "mae_dtheta": 0.03935398906469345,
      "mae_dx": 0.018629666417837143,
      "mae_dy": 0.008302336558699608,
      "pose_mae_dtheta": 0.3281066417694092,
      "pose_mae_dx": 0.14916911721229553,
      "pose_mae_dy": 0.10249995440244675,
      "pose_rmse_dtheta": 0.5238009691238403,
      "pose_rmse_dx": 0.2620517313480377,
      "pose_rmse_dy": 0.213668555021286,
      "pose_rmse_mean": 0.3331737518310547,
      "rmse_dtheta": 0.054824914783239365,
      "rmse_dx": 0.030920712277293205,
      "rmse_dy": 0.013190445490181446,
      "rmse_mean": 0.032978691160678864,
      "rotation_flip": 0.012229539453983307,
      "sparse_tokens": 18776.0,
      "step": 332,
      "turn_loss": 0.3306838870048523,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.015471102025645792,
      "grad_norm": 0.5601977109909058,
      "learning_rate": 9.992144662586521e-06,
      "loss": 0.1489,
      "mae_dtheta": 0.02432279847562313,
      "mae_dx": 0.012484942562878132,
      "mae_dy": 0.008215281181037426,
      "pose_mae_dtheta": 0.16619491577148438,
      "pose_mae_dx": 0.10296839475631714,
      "pose_mae_dy": 0.08858735114336014,
      "pose_rmse_dtheta": 0.2741183042526245,
      "pose_rmse_dx": 0.19019365310668945,
      "pose_rmse_dy": 0.20885203778743744,
      "pose_rmse_mean": 0.2243880033493042,
      "rmse_dtheta": 0.038642726838588715,
      "rmse_dx": 0.022384805604815483,
      "rmse_dy": 0.017928488552570343,
      "rmse_mean": 0.02631867490708828,
      "rotation_flip": 0.027397260069847107,
      "sparse_tokens": 5705.0,
      "step": 333,
      "turn_loss": 0.2709052562713623,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.015517561791488572,
      "grad_norm": 0.5927754044532776,
      "learning_rate": 9.992070400489581e-06,
      "loss": 0.1508,
      "mae_dtheta": 0.015028625726699829,
      "mae_dx": 0.004814320243895054,
      "mae_dy": 0.0035535090137273073,
      "pose_mae_dtheta": 0.11282499134540558,
      "pose_mae_dx": 0.031957849860191345,
      "pose_mae_dy": 0.031421929597854614,
      "pose_rmse_dtheta": 0.2907300889492035,
      "pose_rmse_dx": 0.08105774968862534,
      "pose_rmse_dy": 0.08487124741077423,
      "pose_rmse_mean": 0.15221969783306122,
      "rmse_dtheta": 0.03499975427985191,
      "rmse_dx": 0.01375195849686861,
      "rmse_dy": 0.010861418209969997,
      "rmse_mean": 0.019871044903993607,
      "rotation_flip": 0.0070191859267652035,
      "sparse_tokens": 32185.0,
      "step": 334,
      "turn_loss": 0.16436298191547394,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.01556402155733135,
      "grad_norm": 0.3868262469768524,
      "learning_rate": 9.991995789294477e-06,
      "loss": 0.1412,
      "mae_dtheta": 0.008570278994739056,
      "mae_dx": 0.001863064244389534,
      "mae_dy": 0.0008506295853294432,
      "pose_mae_dtheta": 0.06043536216020584,
      "pose_mae_dx": 0.017865696921944618,
      "pose_mae_dy": 0.012132654897868633,
      "pose_rmse_dtheta": 0.19497224688529968,
      "pose_rmse_dx": 0.04342474043369293,
      "pose_rmse_dy": 0.033625658601522446,
      "pose_rmse_mean": 0.09067421406507492,
      "rmse_dtheta": 0.025682155042886734,
      "rmse_dx": 0.005363093223422766,
      "rmse_dy": 0.0019966764375567436,
      "rmse_mean": 0.011013975366950035,
      "rotation_flip": 0.0023134760558605194,
      "sparse_tokens": 32153.0,
      "step": 335,
      "turn_loss": 0.06236221268773079,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.01561048132317413,
      "grad_norm": 0.5358120203018188,
      "learning_rate": 9.991920829006429e-06,
      "loss": 0.1294,
      "mae_dtheta": 0.00981151219457388,
      "mae_dx": 0.0017283334163948894,
      "mae_dy": 0.0007499690400436521,
      "pose_mae_dtheta": 0.07717407494783401,
      "pose_mae_dx": 0.01699039153754711,
      "pose_mae_dy": 0.013025219552218914,
      "pose_rmse_dtheta": 0.27154046297073364,
      "pose_rmse_dx": 0.03621015325188637,
      "pose_rmse_dy": 0.039200399070978165,
      "pose_rmse_mean": 0.11565034091472626,
      "rmse_dtheta": 0.030285006389021873,
      "rmse_dx": 0.004588093608617783,
      "rmse_dy": 0.001559138298034668,
      "rmse_mean": 0.012144079431891441,
      "rotation_flip": 0.004052685108035803,
      "sparse_tokens": 32185.0,
      "step": 336,
      "turn_loss": 0.05034637823700905,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.015656941089016913,
      "grad_norm": 0.5879629254341125,
      "learning_rate": 9.991845519630679e-06,
      "loss": 0.1272,
      "mae_dtheta": 0.01237774919718504,
      "mae_dx": 0.002406477462500334,
      "mae_dy": 0.0035031114239245653,
      "pose_mae_dtheta": 0.08491489291191101,
      "pose_mae_dx": 0.03166942298412323,
      "pose_mae_dy": 0.043579645454883575,
      "pose_rmse_dtheta": 0.17277225852012634,
      "pose_rmse_dx": 0.07488669455051422,
      "pose_rmse_dy": 0.10509732365608215,
      "pose_rmse_mean": 0.11758542060852051,
      "rmse_dtheta": 0.023059463128447533,
      "rmse_dx": 0.006930295377969742,
      "rmse_dy": 0.007717608939856291,
      "rmse_mean": 0.012569122016429901,
      "rotation_flip": 0.010063362307846546,
      "sparse_tokens": 32073.0,
      "step": 337,
      "turn_loss": 0.0975659117102623,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.015703400854859693,
      "grad_norm": 0.5477492213249207,
      "learning_rate": 9.991769861172492e-06,
      "loss": 0.1244,
      "mae_dtheta": 0.00990509707480669,
      "mae_dx": 0.003011314431205392,
      "mae_dy": 0.0021104607731103897,
      "pose_mae_dtheta": 0.07416906952857971,
      "pose_mae_dx": 0.029394371435046196,
      "pose_mae_dy": 0.0285608172416687,
      "pose_rmse_dtheta": 0.17811447381973267,
      "pose_rmse_dx": 0.07475797086954117,
      "pose_rmse_dy": 0.07834264636039734,
      "pose_rmse_mean": 0.11040502786636353,
      "rmse_dtheta": 0.022401558235287666,
      "rmse_dx": 0.009294587187469006,
      "rmse_dy": 0.005651023704558611,
      "rmse_mean": 0.012449055910110474,
      "rotation_flip": 0.007651841267943382,
      "sparse_tokens": 32137.0,
      "step": 338,
      "turn_loss": 0.08424900472164154,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.015749860620702473,
      "grad_norm": 0.39964374899864197,
      "learning_rate": 9.991693853637159e-06,
      "loss": 0.0862,
      "mae_dtheta": 0.008891448378562927,
      "mae_dx": 0.002405251609161496,
      "mae_dy": 0.0010981917148455977,
      "pose_mae_dtheta": 0.06537926942110062,
      "pose_mae_dx": 0.02211456373333931,
      "pose_mae_dy": 0.01662805676460266,
      "pose_rmse_dtheta": 0.20280417799949646,
      "pose_rmse_dx": 0.056437816470861435,
      "pose_rmse_dy": 0.05004509165883064,
      "pose_rmse_mean": 0.10309570282697678,
      "rmse_dtheta": 0.02508855052292347,
      "rmse_dx": 0.007038584910333157,
      "rmse_dy": 0.0034775028470903635,
      "rmse_mean": 0.01186821237206459,
      "rotation_flip": 0.0022727272007614374,
      "sparse_tokens": 32153.0,
      "step": 339,
      "turn_loss": 0.06415095180273056,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.015796320386545253,
      "grad_norm": 0.610657274723053,
      "learning_rate": 9.991617497029995e-06,
      "loss": 0.1054,
      "mae_dtheta": 0.010473815724253654,
      "mae_dx": 0.002359016565605998,
      "mae_dy": 0.003022527787834406,
      "pose_mae_dtheta": 0.08156023174524307,
      "pose_mae_dx": 0.03370407596230507,
      "pose_mae_dy": 0.035125430673360825,
      "pose_rmse_dtheta": 0.22618472576141357,
      "pose_rmse_dx": 0.09260766208171844,
      "pose_rmse_dy": 0.1176186129450798,
      "pose_rmse_mean": 0.14547035098075867,
      "rmse_dtheta": 0.026602042838931084,
      "rmse_dx": 0.006325989495962858,
      "rmse_dy": 0.0087071368470788,
      "rmse_mean": 0.01387838926166296,
      "rotation_flip": 0.005364806856960058,
      "sparse_tokens": 32105.0,
      "step": 340,
      "turn_loss": 0.09464316815137863,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.015842780152388033,
      "grad_norm": 0.4408782422542572,
      "learning_rate": 9.991540791356342e-06,
      "loss": 0.1091,
      "mae_dtheta": 0.008208699524402618,
      "mae_dx": 0.001938898698426783,
      "mae_dy": 0.0017545860027894378,
      "pose_mae_dtheta": 0.065274178981781,
      "pose_mae_dx": 0.02253865636885166,
      "pose_mae_dy": 0.023994309827685356,
      "pose_rmse_dtheta": 0.18120938539505005,
      "pose_rmse_dx": 0.06402977555990219,
      "pose_rmse_dy": 0.07430527359247208,
      "pose_rmse_mean": 0.1065148115158081,
      "rmse_dtheta": 0.021090002730488777,
      "rmse_dx": 0.006357248872518539,
      "rmse_dy": 0.005405817646533251,
      "rmse_mean": 0.010951023548841476,
      "rotation_flip": 0.006157635245472193,
      "sparse_tokens": 32057.0,
      "step": 341,
      "turn_loss": 0.06059105321764946,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.015889239918230814,
      "grad_norm": 0.5440206527709961,
      "learning_rate": 9.99146373662156e-06,
      "loss": 0.1355,
      "mae_dtheta": 0.02864038199186325,
      "mae_dx": 0.01174358744174242,
      "mae_dy": 0.006444681901484728,
      "pose_mae_dtheta": 0.1997785121202469,
      "pose_mae_dx": 0.07549025118350983,
      "pose_mae_dy": 0.08169815689325333,
      "pose_rmse_dtheta": 0.34860336780548096,
      "pose_rmse_dx": 0.13503015041351318,
      "pose_rmse_dy": 0.1760319620370865,
      "pose_rmse_mean": 0.21988849341869354,
      "rmse_dtheta": 0.04316207394003868,
      "rmse_dx": 0.02290431037545204,
      "rmse_dy": 0.011396363377571106,
      "rmse_mean": 0.025820916518568993,
      "rotation_flip": 0.004830917809158564,
      "sparse_tokens": 4151.0,
      "step": 342,
      "turn_loss": 0.29327207803726196,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.015935699684073594,
      "grad_norm": 0.406512588262558,
      "learning_rate": 9.991386332831042e-06,
      "loss": 0.0896,
      "mae_dtheta": 0.008764048106968403,
      "mae_dx": 0.0023351276759058237,
      "mae_dy": 0.0024544645566493273,
      "pose_mae_dtheta": 0.06504735350608826,
      "pose_mae_dx": 0.031033918261528015,
      "pose_mae_dy": 0.027522964403033257,
      "pose_rmse_dtheta": 0.14180006086826324,
      "pose_rmse_dx": 0.07703471183776855,
      "pose_rmse_dy": 0.06511864066123962,
      "pose_rmse_mean": 0.09465114772319794,
      "rmse_dtheta": 0.018211036920547485,
      "rmse_dx": 0.006179532036185265,
      "rmse_dy": 0.0053328778594732285,
      "rmse_mean": 0.009907815605401993,
      "rotation_flip": 0.0027635216247290373,
      "sparse_tokens": 32121.0,
      "step": 343,
      "turn_loss": 0.07482974976301193,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.01598215944991637,
      "grad_norm": 0.8521841764450073,
      "learning_rate": 9.991308579990197e-06,
      "loss": 0.2484,
      "mae_dtheta": 0.053939301520586014,
      "mae_dx": 0.012440969236195087,
      "mae_dy": 0.010461349040269852,
      "pose_mae_dtheta": 0.49132251739501953,
      "pose_mae_dx": 0.13266350328922272,
      "pose_mae_dy": 0.13067008554935455,
      "pose_rmse_dtheta": 0.7449656128883362,
      "pose_rmse_dx": 0.24169541895389557,
      "pose_rmse_dy": 0.2851817309856415,
      "pose_rmse_mean": 0.4239475727081299,
      "rmse_dtheta": 0.07203901559114456,
      "rmse_dx": 0.02214997448027134,
      "rmse_dy": 0.024492403492331505,
      "rmse_mean": 0.039560467004776,
      "rotation_flip": 0.010989011265337467,
      "sparse_tokens": 4689.0,
      "step": 344,
      "turn_loss": 0.49795615673065186,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.01602861921575915,
      "grad_norm": 0.7937517762184143,
      "learning_rate": 9.991230478104466e-06,
      "loss": 0.1845,
      "mae_dtheta": 0.04107263311743736,
      "mae_dx": 0.01556064747273922,
      "mae_dy": 0.00455275597050786,
      "pose_mae_dtheta": 0.35856401920318604,
      "pose_mae_dx": 0.13961802423000336,
      "pose_mae_dy": 0.06325625628232956,
      "pose_rmse_dtheta": 0.5552829504013062,
      "pose_rmse_dx": 0.2688865661621094,
      "pose_rmse_dy": 0.14565402269363403,
      "pose_rmse_mean": 0.32327452301979065,
      "rmse_dtheta": 0.05677669495344162,
      "rmse_dx": 0.028368307277560234,
      "rmse_dy": 0.008985347114503384,
      "rmse_mean": 0.03137678653001785,
      "rotation_flip": 0.005934718064963818,
      "sparse_tokens": 11700.0,
      "step": 345,
      "turn_loss": 0.3461802899837494,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.01607507898160193,
      "grad_norm": 0.9118670225143433,
      "learning_rate": 9.991152027179307e-06,
      "loss": 0.172,
      "mae_dtheta": 0.03030477464199066,
      "mae_dx": 0.011777223087847233,
      "mae_dy": 0.009220256470143795,
      "pose_mae_dtheta": 0.2301032394170761,
      "pose_mae_dx": 0.08887995779514313,
      "pose_mae_dy": 0.09998198598623276,
      "pose_rmse_dtheta": 0.40108782052993774,
      "pose_rmse_dx": 0.19393181800842285,
      "pose_rmse_dy": 0.23789308965206146,
      "pose_rmse_mean": 0.2776376008987427,
      "rmse_dtheta": 0.047669801861047745,
      "rmse_dx": 0.02338612638413906,
      "rmse_dy": 0.019431456923484802,
      "rmse_mean": 0.03016246110200882,
      "rotation_flip": 0.01123595517128706,
      "sparse_tokens": 14225.0,
      "step": 346,
      "turn_loss": 0.3648073673248291,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.01612153874744471,
      "grad_norm": 0.6051273941993713,
      "learning_rate": 9.99107322722021e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.012252452783286572,
      "mae_dx": 0.0026654116809368134,
      "mae_dy": 0.002107136882841587,
      "pose_mae_dtheta": 0.07654979825019836,
      "pose_mae_dx": 0.027574891224503517,
      "pose_mae_dy": 0.029388638213276863,
      "pose_rmse_dtheta": 0.18460720777511597,
      "pose_rmse_dx": 0.06961432099342346,
      "pose_rmse_dy": 0.06437227874994278,
      "pose_rmse_mean": 0.10619793832302094,
      "rmse_dtheta": 0.026287920773029327,
      "rmse_dx": 0.007740090601146221,
      "rmse_dy": 0.004388310946524143,
      "rmse_mean": 0.01280544139444828,
      "rotation_flip": 0.006739978678524494,
      "sparse_tokens": 32169.0,
      "step": 347,
      "turn_loss": 0.09872521460056305,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.016167998513287492,
      "grad_norm": 0.487155020236969,
      "learning_rate": 9.990994078232681e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.008640371263027191,
      "mae_dx": 0.0015370264882221818,
      "mae_dy": 0.0011933745117858052,
      "pose_mae_dtheta": 0.06336761265993118,
      "pose_mae_dx": 0.014023718424141407,
      "pose_mae_dy": 0.018073517829179764,
      "pose_rmse_dtheta": 0.21245403587818146,
      "pose_rmse_dx": 0.036857299506664276,
      "pose_rmse_dy": 0.04435993358492851,
      "pose_rmse_mean": 0.09789042174816132,
      "rmse_dtheta": 0.0250192079693079,
      "rmse_dx": 0.005230598151683807,
      "rmse_dy": 0.0028225488495081663,
      "rmse_mean": 0.011024119332432747,
      "rotation_flip": 0.008552229963243008,
      "sparse_tokens": 32089.0,
      "step": 348,
      "turn_loss": 0.05286937206983566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 38288.0,
      "epoch": 0.016214458279130272,
      "grad_norm": 0.596646249294281,
      "learning_rate": 9.990914580222258e-06,
      "loss": 0.1491,
      "mae_dtheta": 0.039255186915397644,
      "mae_dx": 0.014844588935375214,
      "mae_dy": 0.006115269381552935,
      "pose_mae_dtheta": 0.284889280796051,
      "pose_mae_dx": 0.11144339293241501,
      "pose_mae_dy": 0.06757984310388565,
      "pose_rmse_dtheta": 0.5075154304504395,
      "pose_rmse_dx": 0.255109578371048,
      "pose_rmse_dy": 0.17016707360744476,
      "pose_rmse_mean": 0.31093069911003113,
      "rmse_dtheta": 0.05816541239619255,
      "rmse_dx": 0.02814817987382412,
      "rmse_dy": 0.013502154499292374,
      "rmse_mean": 0.0332719162106514,
      "rotation_flip": 0.01803278736770153,
      "sparse_tokens": 29888.0,
      "step": 349,
      "turn_loss": 0.3715369403362274,
      "turns": 118.0,
      "turns_per_sample": 118.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.016260918044973052,
      "grad_norm": 0.8979083895683289,
      "learning_rate": 9.990834733194498e-06,
      "loss": 0.2609,
      "mae_dtheta": 0.022059207782149315,
      "mae_dx": 0.011573654599487782,
      "mae_dy": 0.0027653088327497244,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8979085087776184,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 139.4954376220703,
      "model/head/act_norm_mean": 108.74459931344697,
      "model/head/act_norm_min": 55.37484359741211,
      "model/head/act_over_embed": 74.7303067311797,
      "model/head/grad_frac": 0.1132616177201271,
      "model/head/grad_norm": 0.10169856995344162,
      "model/head/grad_zero_frac": 0.00019004578643944114,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6762399384469697,
      "model/head/update_ratio": 0.0017807725816965103,
      "model/head/weight_delta": 2.1119225025177,
      "model/head/weight_delta_rel": 0.03704937547445297,
      "model/head/weight_norm": 57.1092414855957,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.40950289368629456,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4094519544003615,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.409379243850708,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2813792164135209,
      "model/modality_embedder.encoders.pose/grad_frac": 0.16915254294872284,
      "model/modality_embedder.encoders.pose/grad_norm": 0.15188351273536682,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.521542677238806,
      "model/modality_embedder.encoders.pose/update_ratio": 0.004958385601639748,
      "model/modality_embedder.encoders.pose/weight_delta": 0.597594141960144,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.01952526345849037,
      "model/modality_embedder.encoders.pose/weight_norm": 30.63164520263672,
      "model/modality_embedder/grad_frac": 0.16915254294872284,
      "model/modality_embedder/grad_norm": 0.15188351273536682,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.521542677238806,
      "model/modality_embedder/update_ratio": 0.004958385601639748,
      "model/modality_embedder/weight_delta": 0.597594141960144,
      "model/modality_embedder/weight_delta_rel": 0.01952526345849037,
      "model/modality_embedder/weight_norm": 30.63164520263672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.603515625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.100987554112553,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.04051399230957,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.875214922039094,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10283753275871277,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0923386961221695,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0033619659952819347,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.26853346824645996,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.009785521775484085,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.46568489074707,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.44615936279297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.062161796536795,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.44867992401123,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.535742860088067,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10272698104381561,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.09223943203687668,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.003190058283507824,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.2999471127986908,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.010390402749180794,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.914653778076172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.17803192138672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.802389595358346,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.573342323303223,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.73164369570758,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10117167979478836,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.09084291011095047,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00304521550424397,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.2982137203216553,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.01001345831900835,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.831356048583984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.904541015625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.699090984247235,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.139395713806152,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.035074647350193,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08977571874856949,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08061037957668304,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0027515008114278316,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.24714185297489166,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.008446135558187962,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.296876907348633,
      "model/normalizer/grad_frac": 0.35187119245529175,
      "model/normalizer/grad_norm": 0.31594812870025635,
      "model/normalizer/grad_zero_frac": 0.00021507639030460268,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004066534340381622,
      "model/normalizer/weight_delta": 0.5763633847236633,
      "model/normalizer/weight_delta_rel": 0.007423226721584797,
      "model/normalizer/weight_norm": 77.69468688964844,
      "pose_mae_dtheta": 0.1623155176639557,
      "pose_mae_dx": 0.08676588535308838,
      "pose_mae_dy": 0.039282869547605515,
      "pose_rmse_dtheta": 0.323769748210907,
      "pose_rmse_dx": 0.21015101671218872,
      "pose_rmse_dy": 0.10525526106357574,
      "pose_rmse_mean": 0.2130586802959442,
      "rmse_dtheta": 0.03821995109319687,
      "rmse_dx": 0.02447529509663582,
      "rmse_dy": 0.005610319785773754,
      "rmse_mean": 0.022768523544073105,
      "rotation_flip": 0.007471980061382055,
      "sparse_tokens": 18589.0,
      "step": 350,
      "turn_loss": 0.15487809479236603,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.016307377810815833,
      "grad_norm": 0.7504134774208069,
      "learning_rate": 9.99075453715499e-06,
      "loss": 0.148,
      "mae_dtheta": 0.011879552155733109,
      "mae_dx": 0.0023322829511016607,
      "mae_dy": 0.0029044141992926598,
      "pose_mae_dtheta": 0.08760050684213638,
      "pose_mae_dx": 0.029742786660790443,
      "pose_mae_dy": 0.03728901222348213,
      "pose_rmse_dtheta": 0.18664656579494476,
      "pose_rmse_dx": 0.07322289049625397,
      "pose_rmse_dy": 0.0991813987493515,
      "pose_rmse_mean": 0.11968362331390381,
      "rmse_dtheta": 0.024188730865716934,
      "rmse_dx": 0.006711454596370459,
      "rmse_dy": 0.006333964876830578,
      "rmse_mean": 0.012411383911967278,
      "rotation_flip": 0.011681267991662025,
      "sparse_tokens": 32089.0,
      "step": 351,
      "turn_loss": 0.09758380055427551,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.016353837576658613,
      "grad_norm": 0.6183231472969055,
      "learning_rate": 9.990673992109335e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.013175868429243565,
      "mae_dx": 0.003293093526735902,
      "mae_dy": 0.002936022821813822,
      "pose_mae_dtheta": 0.09136821329593658,
      "pose_mae_dx": 0.035530079156160355,
      "pose_mae_dy": 0.038921501487493515,
      "pose_rmse_dtheta": 0.20235154032707214,
      "pose_rmse_dx": 0.0791938528418541,
      "pose_rmse_dy": 0.09403865039348602,
      "pose_rmse_mean": 0.1251946985721588,
      "rmse_dtheta": 0.02598402090370655,
      "rmse_dx": 0.008433923125267029,
      "rmse_dy": 0.007117387838661671,
      "rmse_mean": 0.013845110312104225,
      "rotation_flip": 0.007355516776442528,
      "sparse_tokens": 32169.0,
      "step": 352,
      "turn_loss": 0.14844441413879395,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.016400297342501393,
      "grad_norm": 0.550070583820343,
      "learning_rate": 9.99059309806317e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.027177877724170685,
      "mae_dx": 0.01444868091493845,
      "mae_dy": 0.0032110982574522495,
      "pose_mae_dtheta": 0.25409772992134094,
      "pose_mae_dx": 0.11982298642396927,
      "pose_mae_dy": 0.046078428626060486,
      "pose_rmse_dtheta": 0.40793943405151367,
      "pose_rmse_dx": 0.27131742238998413,
      "pose_rmse_dy": 0.10462293773889542,
      "pose_rmse_mean": 0.26129329204559326,
      "rmse_dtheta": 0.04188312590122223,
      "rmse_dx": 0.028035270050168037,
      "rmse_dy": 0.00628628209233284,
      "rmse_mean": 0.025401558727025986,
      "rotation_flip": 0.019480518996715546,
      "sparse_tokens": 11913.0,
      "step": 353,
      "turn_loss": 0.22960220277309418,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.016446757108344173,
      "grad_norm": 0.8078722357749939,
      "learning_rate": 9.990511855022154e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.012023054994642735,
      "mae_dx": 0.0017756681190803647,
      "mae_dy": 0.003102130489423871,
      "pose_mae_dtheta": 0.08697926253080368,
      "pose_mae_dx": 0.03284437954425812,
      "pose_mae_dy": 0.03996653109788895,
      "pose_rmse_dtheta": 0.20894551277160645,
      "pose_rmse_dx": 0.08350710570812225,
      "pose_rmse_dy": 0.09705440700054169,
      "pose_rmse_mean": 0.12983569502830505,
      "rmse_dtheta": 0.024000773206353188,
      "rmse_dx": 0.00466014863923192,
      "rmse_dy": 0.006601971574127674,
      "rmse_mean": 0.011754298582673073,
      "rotation_flip": 0.00424382695928216,
      "sparse_tokens": 32089.0,
      "step": 354,
      "turn_loss": 0.0855611264705658,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.016493216874186954,
      "grad_norm": 1.336817979812622,
      "learning_rate": 9.990430262991962e-06,
      "loss": 0.2548,
      "mae_dtheta": 0.0313400961458683,
      "mae_dx": 0.012578802183270454,
      "mae_dy": 0.00617976812645793,
      "pose_mae_dtheta": 0.22646357119083405,
      "pose_mae_dx": 0.09944765269756317,
      "pose_mae_dy": 0.10269644856452942,
      "pose_rmse_dtheta": 0.35271796584129333,
      "pose_rmse_dx": 0.22263692319393158,
      "pose_rmse_dy": 0.18970654904842377,
      "pose_rmse_mean": 0.25502049922943115,
      "rmse_dtheta": 0.04453412815928459,
      "rmse_dx": 0.02629958465695381,
      "rmse_dy": 0.009562860243022442,
      "rmse_mean": 0.026798857375979424,
      "rotation_flip": 0.009039548225700855,
      "sparse_tokens": 15654.0,
      "step": 355,
      "turn_loss": 0.24709609150886536,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.016539676640029734,
      "grad_norm": 1.2197680473327637,
      "learning_rate": 9.990348321978304e-06,
      "loss": 0.2124,
      "mae_dtheta": 0.019091935828328133,
      "mae_dx": 0.004234024323523045,
      "mae_dy": 0.005094979424029589,
      "pose_mae_dtheta": 0.13899727165699005,
      "pose_mae_dx": 0.04914960265159607,
      "pose_mae_dy": 0.05142322555184364,
      "pose_rmse_dtheta": 0.3059871196746826,
      "pose_rmse_dx": 0.10617583245038986,
      "pose_rmse_dy": 0.1262052208185196,
      "pose_rmse_mean": 0.17945605516433716,
      "rmse_dtheta": 0.035631634294986725,
      "rmse_dx": 0.01111855823546648,
      "rmse_dy": 0.012869586236774921,
      "rmse_mean": 0.019873259589076042,
      "rotation_flip": 0.008421823382377625,
      "sparse_tokens": 32105.0,
      "step": 356,
      "turn_loss": 0.17721247673034668,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.016586136405872514,
      "grad_norm": 0.9640293121337891,
      "learning_rate": 9.990266031986909e-06,
      "loss": 0.1805,
      "mae_dtheta": 0.04085554927587509,
      "mae_dx": 0.015952706336975098,
      "mae_dy": 0.005983220413327217,
      "pose_mae_dtheta": 0.33062660694122314,
      "pose_mae_dx": 0.13256023824214935,
      "pose_mae_dy": 0.08317393064498901,
      "pose_rmse_dtheta": 0.5682883858680725,
      "pose_rmse_dx": 0.24621859192848206,
      "pose_rmse_dy": 0.16557800769805908,
      "pose_rmse_mean": 0.3266950249671936,
      "rmse_dtheta": 0.05938665196299553,
      "rmse_dx": 0.028236670419573784,
      "rmse_dy": 0.010323106311261654,
      "rmse_mean": 0.032648809254169464,
      "rotation_flip": 0.008522727526724339,
      "sparse_tokens": 13275.0,
      "step": 357,
      "turn_loss": 0.30174821615219116,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.016632596171715294,
      "grad_norm": 0.7517467737197876,
      "learning_rate": 9.990183393023533e-06,
      "loss": 0.1766,
      "mae_dtheta": 0.01196287851780653,
      "mae_dx": 0.003734464989975095,
      "mae_dy": 0.003995235078036785,
      "pose_mae_dtheta": 0.09380830079317093,
      "pose_mae_dx": 0.04651547968387604,
      "pose_mae_dy": 0.03533205762505531,
      "pose_rmse_dtheta": 0.22242282330989838,
      "pose_rmse_dx": 0.16078397631645203,
      "pose_rmse_dy": 0.0951654464006424,
      "pose_rmse_mean": 0.15945741534233093,
      "rmse_dtheta": 0.026994245126843452,
      "rmse_dx": 0.011844528838992119,
      "rmse_dy": 0.011803687550127506,
      "rmse_mean": 0.0168808214366436,
      "rotation_flip": 0.013108613900840282,
      "sparse_tokens": 32073.0,
      "step": 358,
      "turn_loss": 0.14523185789585114,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.016679055937558075,
      "grad_norm": 0.7440666556358337,
      "learning_rate": 9.990100405093954e-06,
      "loss": 0.2056,
      "mae_dtheta": 0.013614088296890259,
      "mae_dx": 0.0042627849616110325,
      "mae_dy": 0.004530671983957291,
      "pose_mae_dtheta": 0.10968978703022003,
      "pose_mae_dx": 0.0410463809967041,
      "pose_mae_dy": 0.049050088971853256,
      "pose_rmse_dtheta": 0.27798914909362793,
      "pose_rmse_dx": 0.11822570115327835,
      "pose_rmse_dy": 0.15013335645198822,
      "pose_rmse_mean": 0.1821160763502121,
      "rmse_dtheta": 0.031009916216135025,
      "rmse_dx": 0.01330567803233862,
      "rmse_dy": 0.012291520833969116,
      "rmse_mean": 0.01886903867125511,
      "rotation_flip": 0.007615421433001757,
      "sparse_tokens": 32121.0,
      "step": 359,
      "turn_loss": 0.1492217481136322,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.016725515703400855,
      "grad_norm": 0.8076798319816589,
      "learning_rate": 9.990017068203975e-06,
      "loss": 0.115,
      "mae_dtheta": 0.015111375600099564,
      "mae_dx": 0.002887318842113018,
      "mae_dy": 0.003598705865442753,
      "pose_mae_dtheta": 0.1107809841632843,
      "pose_mae_dx": 0.0341474674642086,
      "pose_mae_dy": 0.04651568830013275,
      "pose_rmse_dtheta": 0.22073744237422943,
      "pose_rmse_dx": 0.0881488099694252,
      "pose_rmse_dy": 0.1190076395869255,
      "pose_rmse_mean": 0.14263130724430084,
      "rmse_dtheta": 0.027715327218174934,
      "rmse_dx": 0.008879182860255241,
      "rmse_dy": 0.008629019372165203,
      "rmse_mean": 0.015074510127305984,
      "rotation_flip": 0.008139104582369328,
      "sparse_tokens": 32105.0,
      "step": 360,
      "turn_loss": 0.11872442066669464,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.016771975469243635,
      "grad_norm": 0.5224937796592712,
      "learning_rate": 9.989933382359423e-06,
      "loss": 0.142,
      "mae_dtheta": 0.010370578616857529,
      "mae_dx": 0.0022151002194732428,
      "mae_dy": 0.0024709657300263643,
      "pose_mae_dtheta": 0.07497046142816544,
      "pose_mae_dx": 0.02783963643014431,
      "pose_mae_dy": 0.02989000827074051,
      "pose_rmse_dtheta": 0.18496468663215637,
      "pose_rmse_dx": 0.08470797538757324,
      "pose_rmse_dy": 0.07744820415973663,
      "pose_rmse_mean": 0.11570696532726288,
      "rmse_dtheta": 0.02345295436680317,
      "rmse_dx": 0.007303202524781227,
      "rmse_dy": 0.006694026291370392,
      "rmse_mean": 0.012483394704759121,
      "rotation_flip": 0.005220417864620686,
      "sparse_tokens": 32041.0,
      "step": 361,
      "turn_loss": 0.0887126550078392,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.016818435235086415,
      "grad_norm": 0.7081311345100403,
      "learning_rate": 9.989849347566153e-06,
      "loss": 0.1797,
      "mae_dtheta": 0.037911366671323776,
      "mae_dx": 0.011733206920325756,
      "mae_dy": 0.006565380841493607,
      "pose_mae_dtheta": 0.32575422525405884,
      "pose_mae_dx": 0.08901962637901306,
      "pose_mae_dy": 0.07985514402389526,
      "pose_rmse_dtheta": 0.579096257686615,
      "pose_rmse_dx": 0.20347468554973602,
      "pose_rmse_dy": 0.22727742791175842,
      "pose_rmse_mean": 0.3366161286830902,
      "rmse_dtheta": 0.057164665311574936,
      "rmse_dx": 0.024245884269475937,
      "rmse_dy": 0.014398094266653061,
      "rmse_mean": 0.03193621337413788,
      "rotation_flip": 0.010620915330946445,
      "sparse_tokens": 20601.0,
      "step": 362,
      "turn_loss": 0.32768139243125916,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.016864895000929195,
      "grad_norm": 0.5737762451171875,
      "learning_rate": 9.989764963830038e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.009728222154080868,
      "mae_dx": 0.0018664770759642124,
      "mae_dy": 0.0007689272169955075,
      "pose_mae_dtheta": 0.07146821171045303,
      "pose_mae_dx": 0.017386404797434807,
      "pose_mae_dy": 0.012802578508853912,
      "pose_rmse_dtheta": 0.253188818693161,
      "pose_rmse_dx": 0.04316386207938194,
      "pose_rmse_dy": 0.033949337899684906,
      "pose_rmse_mean": 0.11010067909955978,
      "rmse_dtheta": 0.029756972566246986,
      "rmse_dx": 0.005591542925685644,
      "rmse_dy": 0.0018415756057947874,
      "rmse_mean": 0.012396696954965591,
      "rotation_flip": 0.003588516730815172,
      "sparse_tokens": 32137.0,
      "step": 363,
      "turn_loss": 0.05690263584256172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.016911354766771976,
      "grad_norm": 0.8705506920814514,
      "learning_rate": 9.989680231156983e-06,
      "loss": 0.132,
      "mae_dtheta": 0.01324421912431717,
      "mae_dx": 0.002415412338450551,
      "mae_dy": 0.0018627403769642115,
      "pose_mae_dtheta": 0.09152749180793762,
      "pose_mae_dx": 0.02447991445660591,
      "pose_mae_dy": 0.022456660866737366,
      "pose_rmse_dtheta": 0.26278194785118103,
      "pose_rmse_dx": 0.059641219675540924,
      "pose_rmse_dy": 0.06591878831386566,
      "pose_rmse_mean": 0.1294473260641098,
      "rmse_dtheta": 0.03278249874711037,
      "rmse_dx": 0.006579904351383448,
      "rmse_dy": 0.005436148028820753,
      "rmse_mean": 0.014932851307094097,
      "rotation_flip": 0.005082095507532358,
      "sparse_tokens": 32233.0,
      "step": 364,
      "turn_loss": 0.09807316958904266,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.016957814532614756,
      "grad_norm": 0.7311589121818542,
      "learning_rate": 9.98959514955291e-06,
      "loss": 0.2031,
      "mae_dtheta": 0.009725517593324184,
      "mae_dx": 0.0026913040783256292,
      "mae_dy": 0.001778035657480359,
      "pose_mae_dtheta": 0.07034897059202194,
      "pose_mae_dx": 0.02455465868115425,
      "pose_mae_dy": 0.018927376717329025,
      "pose_rmse_dtheta": 0.2003227025270462,
      "pose_rmse_dx": 0.07709461450576782,
      "pose_rmse_dy": 0.05808357521891594,
      "pose_rmse_mean": 0.11183362454175949,
      "rmse_dtheta": 0.02605598047375679,
      "rmse_dx": 0.00791662372648716,
      "rmse_dy": 0.0059898775070905685,
      "rmse_mean": 0.013320828787982464,
      "rotation_flip": 0.0044742729514837265,
      "sparse_tokens": 32185.0,
      "step": 365,
      "turn_loss": 0.0810641348361969,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.017004274298457536,
      "grad_norm": 0.5510680079460144,
      "learning_rate": 9.98950971902377e-06,
      "loss": 0.1122,
      "mae_dtheta": 0.012885719537734985,
      "mae_dx": 0.002236952306702733,
      "mae_dy": 0.002288541756570339,
      "pose_mae_dtheta": 0.09270470589399338,
      "pose_mae_dx": 0.023630855605006218,
      "pose_mae_dy": 0.0325273722410202,
      "pose_rmse_dtheta": 0.22390614449977875,
      "pose_rmse_dx": 0.05836815759539604,
      "pose_rmse_dy": 0.08061731606721878,
      "pose_rmse_mean": 0.12096387147903442,
      "rmse_dtheta": 0.0286213718354702,
      "rmse_dx": 0.006777620874345303,
      "rmse_dy": 0.005408164579421282,
      "rmse_mean": 0.013602386228740215,
      "rotation_flip": 0.00744634261354804,
      "sparse_tokens": 32105.0,
      "step": 366,
      "turn_loss": 0.0851747915148735,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.017050734064300316,
      "grad_norm": 0.621110200881958,
      "learning_rate": 9.989423939575538e-06,
      "loss": 0.2062,
      "mae_dtheta": 0.039292432367801666,
      "mae_dx": 0.021570732817053795,
      "mae_dy": 0.009858328849077225,
      "pose_mae_dtheta": 0.31884244084358215,
      "pose_mae_dx": 0.14803346991539001,
      "pose_mae_dy": 0.09571828693151474,
      "pose_rmse_dtheta": 0.5047948360443115,
      "pose_rmse_dx": 0.28509289026260376,
      "pose_rmse_dy": 0.1777787208557129,
      "pose_rmse_mean": 0.3225554823875427,
      "rmse_dtheta": 0.05591326579451561,
      "rmse_dx": 0.0349174402654171,
      "rmse_dy": 0.01654476672410965,
      "rmse_mean": 0.035791825503110886,
      "rotation_flip": 0.028938906267285347,
      "sparse_tokens": 5003.0,
      "step": 367,
      "turn_loss": 0.4946438670158386,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.017097193830143097,
      "grad_norm": 0.6371529698371887,
      "learning_rate": 9.98933781121421e-06,
      "loss": 0.1622,
      "mae_dtheta": 0.0375286228954792,
      "mae_dx": 0.010510158725082874,
      "mae_dy": 0.003220530692487955,
      "pose_mae_dtheta": 0.28841063380241394,
      "pose_mae_dx": 0.08601870387792587,
      "pose_mae_dy": 0.03573917970061302,
      "pose_rmse_dtheta": 0.5088664889335632,
      "pose_rmse_dx": 0.19156122207641602,
      "pose_rmse_dy": 0.11102014034986496,
      "pose_rmse_mean": 0.2704826295375824,
      "rmse_dtheta": 0.058073751628398895,
      "rmse_dx": 0.02198977582156658,
      "rmse_dy": 0.006291315890848637,
      "rmse_mean": 0.028784949332475662,
      "rotation_flip": 0.01565217413008213,
      "sparse_tokens": 10259.0,
      "step": 368,
      "turn_loss": 0.24169841408729553,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 43678.0,
      "epoch": 0.017143653595985877,
      "grad_norm": 0.7923142910003662,
      "learning_rate": 9.989251333945813e-06,
      "loss": 0.2743,
      "mae_dtheta": 0.03562941774725914,
      "mae_dx": 0.014062583446502686,
      "mae_dy": 0.004182199947535992,
      "pose_mae_dtheta": 0.2821805775165558,
      "pose_mae_dx": 0.11018360406160355,
      "pose_mae_dy": 0.05131185054779053,
      "pose_rmse_dtheta": 0.48231610655784607,
      "pose_rmse_dx": 0.2381751388311386,
      "pose_rmse_dy": 0.11856088787317276,
      "pose_rmse_mean": 0.27968406677246094,
      "rmse_dtheta": 0.05223555117845535,
      "rmse_dx": 0.026783592998981476,
      "rmse_dy": 0.007698606699705124,
      "rmse_mean": 0.028905918821692467,
      "rotation_flip": 0.012658228166401386,
      "sparse_tokens": 30178.0,
      "step": 369,
      "turn_loss": 0.28378352522850037,
      "turns": 135.0,
      "turns_per_sample": 135.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.017190113361828657,
      "grad_norm": 0.5673419833183289,
      "learning_rate": 9.989164507776391e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.011963071301579475,
      "mae_dx": 0.002436938928440213,
      "mae_dy": 0.0031835203990340233,
      "pose_mae_dtheta": 0.08038049191236496,
      "pose_mae_dx": 0.029360776767134666,
      "pose_mae_dy": 0.0395536832511425,
      "pose_rmse_dtheta": 0.1512557566165924,
      "pose_rmse_dx": 0.07013925164937973,
      "pose_rmse_dy": 0.07852310687303543,
      "pose_rmse_mean": 0.09997271001338959,
      "rmse_dtheta": 0.021629031747579575,
      "rmse_dx": 0.0076623340137302876,
      "rmse_dy": 0.007012820802628994,
      "rmse_mean": 0.01210139598697424,
      "rotation_flip": 0.006965944077819586,
      "sparse_tokens": 32089.0,
      "step": 370,
      "turn_loss": 0.10769650340080261,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.017236573127671437,
      "grad_norm": 1.0258653163909912,
      "learning_rate": 9.989077332712019e-06,
      "loss": 0.3238,
      "mae_dtheta": 0.03705567121505737,
      "mae_dx": 0.01205934677273035,
      "mae_dy": 0.0034493703860789537,
      "pose_mae_dtheta": 0.28258123993873596,
      "pose_mae_dx": 0.09101949632167816,
      "pose_mae_dy": 0.031682517379522324,
      "pose_rmse_dtheta": 0.477835088968277,
      "pose_rmse_dx": 0.20902283489704132,
      "pose_rmse_dy": 0.07277169078588486,
      "pose_rmse_mean": 0.2532098889350891,
      "rmse_dtheta": 0.054011207073926926,
      "rmse_dx": 0.023776046931743622,
      "rmse_dy": 0.007300061639398336,
      "rmse_mean": 0.028362438082695007,
      "rotation_flip": 0.013837638311088085,
      "sparse_tokens": 17590.0,
      "step": 371,
      "turn_loss": 0.27129629254341125,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.017283032893514218,
      "grad_norm": 0.564264714717865,
      "learning_rate": 9.98898980875879e-06,
      "loss": 0.123,
      "mae_dtheta": 0.035366080701351166,
      "mae_dx": 0.011261110194027424,
      "mae_dy": 0.005907791666686535,
      "pose_mae_dtheta": 0.27980121970176697,
      "pose_mae_dx": 0.10085535794496536,
      "pose_mae_dy": 0.08545109629631042,
      "pose_rmse_dtheta": 0.45852404832839966,
      "pose_rmse_dx": 0.21224336326122284,
      "pose_rmse_dy": 0.1721147894859314,
      "pose_rmse_mean": 0.28096073865890503,
      "rmse_dtheta": 0.05007689446210861,
      "rmse_dx": 0.024180496111512184,
      "rmse_dy": 0.01000557467341423,
      "rmse_mean": 0.028087656944990158,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 11840.0,
      "step": 372,
      "turn_loss": 0.29920342564582825,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.017329492659356998,
      "grad_norm": 0.8895359039306641,
      "learning_rate": 9.988901935922826e-06,
      "loss": 0.1825,
      "mae_dtheta": 0.015055899508297443,
      "mae_dx": 0.003591835265979171,
      "mae_dy": 0.0034465892240405083,
      "pose_mae_dtheta": 0.10506091266870499,
      "pose_mae_dx": 0.04343080520629883,
      "pose_mae_dy": 0.04236190766096115,
      "pose_rmse_dtheta": 0.23334555327892303,
      "pose_rmse_dx": 0.10818368941545486,
      "pose_rmse_dy": 0.08731932193040848,
      "pose_rmse_mean": 0.14294952154159546,
      "rmse_dtheta": 0.030043872073292732,
      "rmse_dx": 0.010605024173855782,
      "rmse_dy": 0.006957596633583307,
      "rmse_mean": 0.015868831425905228,
      "rotation_flip": 0.005271695088595152,
      "sparse_tokens": 32041.0,
      "step": 373,
      "turn_loss": 0.13220931589603424,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.017375952425199778,
      "grad_norm": 0.649909257888794,
      "learning_rate": 9.988813714210272e-06,
      "loss": 0.1417,
      "mae_dtheta": 0.012430752627551556,
      "mae_dx": 0.002547440817579627,
      "mae_dy": 0.002418109681457281,
      "pose_mae_dtheta": 0.09264777600765228,
      "pose_mae_dx": 0.029748087748885155,
      "pose_mae_dy": 0.031983885914087296,
      "pose_rmse_dtheta": 0.22052258253097534,
      "pose_rmse_dx": 0.07309272140264511,
      "pose_rmse_dy": 0.07703609019517899,
      "pose_rmse_mean": 0.12355046719312668,
      "rmse_dtheta": 0.02727779559791088,
      "rmse_dx": 0.007981977425515652,
      "rmse_dy": 0.005144890397787094,
      "rmse_mean": 0.013468220829963684,
      "rotation_flip": 0.005524862091988325,
      "sparse_tokens": 32105.0,
      "step": 374,
      "turn_loss": 0.095635324716568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4575.0,
      "epoch": 0.01742241219104256,
      "grad_norm": 0.8985955119132996,
      "learning_rate": 9.988725143627297e-06,
      "loss": 0.1257,
      "mae_dtheta": 0.044279009103775024,
      "mae_dx": 0.011980924755334854,
      "mae_dy": 0.005214092321693897,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8985955715179443,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 132.4311065673828,
      "model/head/act_norm_mean": 98.81965855189732,
      "model/head/act_norm_min": 67.95654296875,
      "model/head/act_over_embed": 67.9097945210834,
      "model/head/grad_frac": 0.10101351141929626,
      "model/head/grad_norm": 0.09077029675245285,
      "model/head/grad_zero_frac": 0.00012627415708266199,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6647600446428571,
      "model/head/update_ratio": 0.0015891337534412742,
      "model/head/weight_delta": 2.197943687438965,
      "model/head/weight_delta_rel": 0.038558442145586014,
      "model/head/weight_norm": 57.119354248046875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4097359776496887,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4096907297770182,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.40964412689208984,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2815433050878097,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06069398671388626,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05453934893012047,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.537109375,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017803554655984044,
      "model/modality_embedder.encoders.pose/weight_delta": 0.6452620625495911,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.021082723513245583,
      "model/modality_embedder.encoders.pose/weight_norm": 30.63396644592285,
      "model/modality_embedder/grad_frac": 0.06069398671388626,
      "model/modality_embedder/grad_norm": 0.05453934893012047,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.537109375,
      "model/modality_embedder/update_ratio": 0.0017803554655984044,
      "model/modality_embedder/weight_delta": 0.6452620625495911,
      "model/modality_embedder/weight_delta_rel": 0.021082723513245583,
      "model/modality_embedder/weight_norm": 30.63396644592285,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 68.89952087402344,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.22250566893424,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.158321380615234,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.27151394606757,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06450895220041275,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05796745792031288,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0021103927865624428,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.28060412406921387,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.010225383564829826,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.467615127563477,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 69.76480102539062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.245892237103174,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.805869102478027,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.974794776809265,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06326707452535629,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05685150995850563,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019659444224089384,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.3160450756549835,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.01094804797321558,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.918169021606445,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 71.69605255126953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.052745447137188,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.261615753173828,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.21648121877091,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0645395964384079,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05799499526619911,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 8.069722389336675e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019437827868387103,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.31549713015556335,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.01059380266815424,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.836151123046875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 71.63092041015625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.058117648100907,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.539671897888184,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.59459176986352,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07207999378442764,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06477076560258865,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002210573758929968,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.2611144185066223,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.008923651650547981,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.300430297851562,
      "model/normalizer/grad_frac": 0.2792714238166809,
      "model/normalizer/grad_norm": 0.2509520649909973,
      "model/normalizer/grad_zero_frac": 0.00011226515198359266,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0032297796569764614,
      "model/normalizer/weight_delta": 0.606581449508667,
      "model/normalizer/weight_delta_rel": 0.007812418043613434,
      "model/normalizer/weight_norm": 77.6994400024414,
      "pose_mae_dtheta": 0.35590827465057373,
      "pose_mae_dx": 0.10563988983631134,
      "pose_mae_dy": 0.06339779496192932,
      "pose_rmse_dtheta": 0.7321695685386658,
      "pose_rmse_dx": 0.25423282384872437,
      "pose_rmse_dy": 0.1501626968383789,
      "pose_rmse_mean": 0.37885504961013794,
      "rmse_dtheta": 0.07273151725530624,
      "rmse_dx": 0.025312406942248344,
      "rmse_dy": 0.01019846461713314,
      "rmse_mean": 0.036080799996852875,
      "rotation_flip": 0.008620689623057842,
      "sparse_tokens": 4042.0,
      "step": 375,
      "turn_loss": 0.4098356068134308,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.01746887195688534,
      "grad_norm": 0.6114588379859924,
      "learning_rate": 9.988636224180097e-06,
      "loss": 0.1426,
      "mae_dtheta": 0.0148782879114151,
      "mae_dx": 0.002625283319503069,
      "mae_dy": 0.0031173487659543753,
      "pose_mae_dtheta": 0.10167361795902252,
      "pose_mae_dx": 0.03457679599523544,
      "pose_mae_dy": 0.03906921297311783,
      "pose_rmse_dtheta": 0.20837260782718658,
      "pose_rmse_dx": 0.0794391930103302,
      "pose_rmse_dy": 0.07933638989925385,
      "pose_rmse_mean": 0.1223827451467514,
      "rmse_dtheta": 0.027311105281114578,
      "rmse_dx": 0.007524318993091583,
      "rmse_dy": 0.0059873550198972225,
      "rmse_mean": 0.01360759325325489,
      "rotation_flip": 0.004832474049180746,
      "sparse_tokens": 32137.0,
      "step": 376,
      "turn_loss": 0.10849864035844803,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.01751533172272812,
      "grad_norm": 0.6874825954437256,
      "learning_rate": 9.988546955874885e-06,
      "loss": 0.1662,
      "mae_dtheta": 0.016018008813261986,
      "mae_dx": 0.004072804935276508,
      "mae_dy": 0.0032518170773983,
      "pose_mae_dtheta": 0.11665249615907669,
      "pose_mae_dx": 0.045864444226026535,
      "pose_mae_dy": 0.04280206933617592,
      "pose_rmse_dtheta": 0.26781633496284485,
      "pose_rmse_dx": 0.11948905140161514,
      "pose_rmse_dy": 0.09435830265283585,
      "pose_rmse_mean": 0.16055455803871155,
      "rmse_dtheta": 0.030599597841501236,
      "rmse_dx": 0.011736682616174221,
      "rmse_dy": 0.006667695939540863,
      "rmse_mean": 0.016334660351276398,
      "rotation_flip": 0.008698677644133568,
      "sparse_tokens": 32105.0,
      "step": 377,
      "turn_loss": 0.1395622342824936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.0175617914885709,
      "grad_norm": 0.6385524868965149,
      "learning_rate": 9.98845733871791e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.013909846544265747,
      "mae_dx": 0.0025724703446030617,
      "mae_dy": 0.0038134159985929728,
      "pose_mae_dtheta": 0.09367199242115021,
      "pose_mae_dx": 0.03885914757847786,
      "pose_mae_dy": 0.04958133026957512,
      "pose_rmse_dtheta": 0.19156132638454437,
      "pose_rmse_dx": 0.10004228353500366,
      "pose_rmse_dy": 0.11061957478523254,
      "pose_rmse_mean": 0.134074404835701,
      "rmse_dtheta": 0.025862719863653183,
      "rmse_dx": 0.007444050628691912,
      "rmse_dy": 0.007771861273795366,
      "rmse_mean": 0.013692877255380154,
      "rotation_flip": 0.01062959898263216,
      "sparse_tokens": 32057.0,
      "step": 378,
      "turn_loss": 0.12277591228485107,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.01760825125441368,
      "grad_norm": 0.8363799452781677,
      "learning_rate": 9.988367372715434e-06,
      "loss": 0.1358,
      "mae_dtheta": 0.031058184802532196,
      "mae_dx": 0.010188180953264236,
      "mae_dy": 0.006501376163214445,
      "pose_mae_dtheta": 0.22132305800914764,
      "pose_mae_dx": 0.09167201817035675,
      "pose_mae_dy": 0.08952465653419495,
      "pose_rmse_dtheta": 0.42401790618896484,
      "pose_rmse_dx": 0.21931242942810059,
      "pose_rmse_dy": 0.18757720291614532,
      "pose_rmse_mean": 0.27696919441223145,
      "rmse_dtheta": 0.050127241760492325,
      "rmse_dx": 0.024123866111040115,
      "rmse_dy": 0.01085555087774992,
      "rmse_mean": 0.028368886560201645,
      "rotation_flip": 0.013282732106745243,
      "sparse_tokens": 9260.0,
      "step": 379,
      "turn_loss": 0.20790140330791473,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.017654711020256456,
      "grad_norm": 0.7842872142791748,
      "learning_rate": 9.988277057873749e-06,
      "loss": 0.1195,
      "mae_dtheta": 0.010000022128224373,
      "mae_dx": 0.0047863624058663845,
      "mae_dy": 0.0012577376328408718,
      "pose_mae_dtheta": 0.07999851554632187,
      "pose_mae_dx": 0.042304158210754395,
      "pose_mae_dy": 0.02339312620460987,
      "pose_rmse_dtheta": 0.20767472684383392,
      "pose_rmse_dx": 0.147312730550766,
      "pose_rmse_dy": 0.05899706482887268,
      "pose_rmse_mean": 0.13799484074115753,
      "rmse_dtheta": 0.024050354957580566,
      "rmse_dx": 0.015170242637395859,
      "rmse_dy": 0.003305281512439251,
      "rmse_mean": 0.0141752939671278,
      "rotation_flip": 0.0008312552236020565,
      "sparse_tokens": 32105.0,
      "step": 380,
      "turn_loss": 0.08348023146390915,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.017701170786099236,
      "grad_norm": 1.1311781406402588,
      "learning_rate": 9.988186394199175e-06,
      "loss": 0.2091,
      "mae_dtheta": 0.02967900224030018,
      "mae_dx": 0.012507515959441662,
      "mae_dy": 0.006272270809859037,
      "pose_mae_dtheta": 0.23997429013252258,
      "pose_mae_dx": 0.10579763352870941,
      "pose_mae_dy": 0.07839957624673843,
      "pose_rmse_dtheta": 0.3673011064529419,
      "pose_rmse_dx": 0.22722744941711426,
      "pose_rmse_dy": 0.160686194896698,
      "pose_rmse_mean": 0.2517382502555847,
      "rmse_dtheta": 0.04359915107488632,
      "rmse_dx": 0.025232432410120964,
      "rmse_dy": 0.010380364954471588,
      "rmse_mean": 0.026403984054923058,
      "rotation_flip": 0.009513742290437222,
      "sparse_tokens": 16687.0,
      "step": 381,
      "turn_loss": 0.27242082357406616,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.017747630551942017,
      "grad_norm": 0.40674564242362976,
      "learning_rate": 9.988095381698047e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.009169496595859528,
      "mae_dx": 0.00239763455465436,
      "mae_dy": 0.0019198475638404489,
      "pose_mae_dtheta": 0.0631568431854248,
      "pose_mae_dx": 0.025786515325307846,
      "pose_mae_dy": 0.02306971326470375,
      "pose_rmse_dtheta": 0.16886653006076813,
      "pose_rmse_dx": 0.07554768770933151,
      "pose_rmse_dy": 0.06487418711185455,
      "pose_rmse_mean": 0.1030961275100708,
      "rmse_dtheta": 0.022226545959711075,
      "rmse_dx": 0.007574054412543774,
      "rmse_dy": 0.00522126629948616,
      "rmse_mean": 0.01167395617812872,
      "rotation_flip": 0.003166226902976632,
      "sparse_tokens": 32105.0,
      "step": 382,
      "turn_loss": 0.07909001410007477,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.017794090317784797,
      "grad_norm": 0.5414519309997559,
      "learning_rate": 9.988004020376734e-06,
      "loss": 0.1719,
      "mae_dtheta": 0.009989039972424507,
      "mae_dx": 0.0027971407398581505,
      "mae_dy": 0.002167896367609501,
      "pose_mae_dtheta": 0.07194992899894714,
      "pose_mae_dx": 0.03098023682832718,
      "pose_mae_dy": 0.03336473926901817,
      "pose_rmse_dtheta": 0.13692574203014374,
      "pose_rmse_dx": 0.08609827607870102,
      "pose_rmse_dy": 0.08076940476894379,
      "pose_rmse_mean": 0.10126447677612305,
      "rmse_dtheta": 0.01880425214767456,
      "rmse_dx": 0.008728068321943283,
      "rmse_dy": 0.004208258353173733,
      "rmse_mean": 0.010580193251371384,
      "rotation_flip": 0.007029877044260502,
      "sparse_tokens": 32089.0,
      "step": 383,
      "turn_loss": 0.0974719300866127,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.017840550083627577,
      "grad_norm": 0.7613227963447571,
      "learning_rate": 9.98791231024162e-06,
      "loss": 0.2352,
      "mae_dtheta": 0.030826542526483536,
      "mae_dx": 0.015895992517471313,
      "mae_dy": 0.005509324837476015,
      "pose_mae_dtheta": 0.2437141239643097,
      "pose_mae_dx": 0.13890589773654938,
      "pose_mae_dy": 0.09054382145404816,
      "pose_rmse_dtheta": 0.41847699880599976,
      "pose_rmse_dx": 0.2956092059612274,
      "pose_rmse_dy": 0.18759645521640778,
      "pose_rmse_mean": 0.3005608916282654,
      "rmse_dtheta": 0.046032391488552094,
      "rmse_dx": 0.030182162299752235,
      "rmse_dy": 0.009728250093758106,
      "rmse_mean": 0.02864760160446167,
      "rotation_flip": 0.014479638077318668,
      "sparse_tokens": 18351.0,
      "step": 384,
      "turn_loss": 0.26973241567611694,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.017887009849470357,
      "grad_norm": 0.8092068433761597,
      "learning_rate": 9.987820251299121e-06,
      "loss": 0.2334,
      "mae_dtheta": 0.03719093278050423,
      "mae_dx": 0.008252871222794056,
      "mae_dy": 0.006279404740780592,
      "pose_mae_dtheta": 0.27872657775878906,
      "pose_mae_dx": 0.06667912751436234,
      "pose_mae_dy": 0.09534095972776413,
      "pose_rmse_dtheta": 0.49106115102767944,
      "pose_rmse_dx": 0.172896146774292,
      "pose_rmse_dy": 0.20608575642108917,
      "pose_rmse_mean": 0.2900143563747406,
      "rmse_dtheta": 0.055209431797266006,
      "rmse_dx": 0.020310457795858383,
      "rmse_dy": 0.01198857557028532,
      "rmse_mean": 0.029169488698244095,
      "rotation_flip": 0.012403100728988647,
      "sparse_tokens": 12317.0,
      "step": 385,
      "turn_loss": 0.28053018450737,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.017933469615313138,
      "grad_norm": 0.49151864647865295,
      "learning_rate": 9.987727843555677e-06,
      "loss": 0.1216,
      "mae_dtheta": 0.038573578000068665,
      "mae_dx": 0.01506761647760868,
      "mae_dy": 0.006934743374586105,
      "pose_mae_dtheta": 0.3144971430301666,
      "pose_mae_dx": 0.12156162410974503,
      "pose_mae_dy": 0.07539515197277069,
      "pose_rmse_dtheta": 0.5413292646408081,
      "pose_rmse_dx": 0.21505220234394073,
      "pose_rmse_dy": 0.17812055349349976,
      "pose_rmse_mean": 0.3115006685256958,
      "rmse_dtheta": 0.055405426770448685,
      "rmse_dx": 0.027197442948818207,
      "rmse_dy": 0.013984940014779568,
      "rmse_mean": 0.03219594061374664,
      "rotation_flip": 0.012406948022544384,
      "sparse_tokens": 7493.0,
      "step": 386,
      "turn_loss": 0.3258882462978363,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.017979929381155918,
      "grad_norm": 0.4525245130062103,
      "learning_rate": 9.987635087017746e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.03310278803110123,
      "mae_dx": 0.010142062790691853,
      "mae_dy": 0.003224117448553443,
      "pose_mae_dtheta": 0.25709205865859985,
      "pose_mae_dx": 0.08138179033994675,
      "pose_mae_dy": 0.04835987091064453,
      "pose_rmse_dtheta": 0.4510340094566345,
      "pose_rmse_dx": 0.19995251297950745,
      "pose_rmse_dy": 0.10315804928541183,
      "pose_rmse_mean": 0.2513815462589264,
      "rmse_dtheta": 0.051022350788116455,
      "rmse_dx": 0.022550811991095543,
      "rmse_dy": 0.0058035277761518955,
      "rmse_mean": 0.026458896696567535,
      "rotation_flip": 0.017674418166279793,
      "sparse_tokens": 18450.0,
      "step": 387,
      "turn_loss": 0.2110024243593216,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.018026389146998698,
      "grad_norm": 0.9137697815895081,
      "learning_rate": 9.987541981691817e-06,
      "loss": 0.3567,
      "mae_dtheta": 0.031200263649225235,
      "mae_dx": 0.007570754271000624,
      "mae_dy": 0.004182928707450628,
      "pose_mae_dtheta": 0.24056147038936615,
      "pose_mae_dx": 0.05640290305018425,
      "pose_mae_dy": 0.05698585510253906,
      "pose_rmse_dtheta": 0.4567221701145172,
      "pose_rmse_dx": 0.13785547018051147,
      "pose_rmse_dy": 0.14080655574798584,
      "pose_rmse_mean": 0.2451280802488327,
      "rmse_dtheta": 0.04959074407815933,
      "rmse_dx": 0.01821180433034897,
      "rmse_dy": 0.007651721127331257,
      "rmse_mean": 0.02515142410993576,
      "rotation_flip": 0.010625737719237804,
      "sparse_tokens": 14632.0,
      "step": 388,
      "turn_loss": 0.23104695975780487,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.01807284891284148,
      "grad_norm": 0.847577691078186,
      "learning_rate": 9.9874485275844e-06,
      "loss": 0.2335,
      "mae_dtheta": 0.03631214052438736,
      "mae_dx": 0.01772211864590645,
      "mae_dy": 0.005857928190380335,
      "pose_mae_dtheta": 0.30688074231147766,
      "pose_mae_dx": 0.1481025367975235,
      "pose_mae_dy": 0.09701904654502869,
      "pose_rmse_dtheta": 0.5166214108467102,
      "pose_rmse_dx": 0.31316283345222473,
      "pose_rmse_dy": 0.2182006686925888,
      "pose_rmse_mean": 0.34932833909988403,
      "rmse_dtheta": 0.05340799689292908,
      "rmse_dx": 0.0329253114759922,
      "rmse_dy": 0.011026141233742237,
      "rmse_mean": 0.03245314955711365,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 10867.0,
      "step": 389,
      "turn_loss": 0.3539811968803406,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.01811930867868426,
      "grad_norm": 0.6123690009117126,
      "learning_rate": 9.987354724702031e-06,
      "loss": 0.1551,
      "mae_dtheta": 0.014278934337198734,
      "mae_dx": 0.003565881634131074,
      "mae_dy": 0.004455268383026123,
      "pose_mae_dtheta": 0.10907186567783356,
      "pose_mae_dx": 0.03989582508802414,
      "pose_mae_dy": 0.05296812951564789,
      "pose_rmse_dtheta": 0.24724416434764862,
      "pose_rmse_dx": 0.09249105304479599,
      "pose_rmse_dy": 0.16954591870307922,
      "pose_rmse_mean": 0.16976039111614227,
      "rmse_dtheta": 0.028010427951812744,
      "rmse_dx": 0.01052780356258154,
      "rmse_dy": 0.01337171345949173,
      "rmse_mean": 0.017303315922617912,
      "rotation_flip": 0.00863557867705822,
      "sparse_tokens": 32153.0,
      "step": 390,
      "turn_loss": 0.13314025104045868,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.01816576844452704,
      "grad_norm": 0.4375985562801361,
      "learning_rate": 9.987260573051268e-06,
      "loss": 0.0951,
      "mae_dtheta": 0.009252689778804779,
      "mae_dx": 0.0024879700504243374,
      "mae_dy": 0.0020427389536052942,
      "pose_mae_dtheta": 0.07111279666423798,
      "pose_mae_dx": 0.03268663212656975,
      "pose_mae_dy": 0.02555866353213787,
      "pose_rmse_dtheta": 0.2116294950246811,
      "pose_rmse_dx": 0.08808227628469467,
      "pose_rmse_dy": 0.07283671945333481,
      "pose_rmse_mean": 0.12418283522129059,
      "rmse_dtheta": 0.024174273014068604,
      "rmse_dx": 0.00761426379904151,
      "rmse_dy": 0.005626628641039133,
      "rmse_mean": 0.012471722438931465,
      "rotation_flip": 0.004081632476300001,
      "sparse_tokens": 32089.0,
      "step": 391,
      "turn_loss": 0.06435252726078033,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.01821222821036982,
      "grad_norm": 1.0083436965942383,
      "learning_rate": 9.987166072638698e-06,
      "loss": 0.2473,
      "mae_dtheta": 0.031252678483724594,
      "mae_dx": 0.01470921654254198,
      "mae_dy": 0.00552367465570569,
      "pose_mae_dtheta": 0.2629302442073822,
      "pose_mae_dx": 0.1105133444070816,
      "pose_mae_dy": 0.08708857744932175,
      "pose_rmse_dtheta": 0.3995700776576996,
      "pose_rmse_dx": 0.22822268307209015,
      "pose_rmse_dy": 0.1741108000278473,
      "pose_rmse_mean": 0.26730120182037354,
      "rmse_dtheta": 0.0449199415743351,
      "rmse_dx": 0.028758330270648003,
      "rmse_dy": 0.009212633594870567,
      "rmse_mean": 0.02763030305504799,
      "rotation_flip": 0.022026430815458298,
      "sparse_tokens": 7462.0,
      "step": 392,
      "turn_loss": 0.2588048279285431,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.0182586879762126,
      "grad_norm": 0.791800856590271,
      "learning_rate": 9.987071223470927e-06,
      "loss": 0.2501,
      "mae_dtheta": 0.03270328789949417,
      "mae_dx": 0.011282478459179401,
      "mae_dy": 0.004846105817705393,
      "pose_mae_dtheta": 0.2454172968864441,
      "pose_mae_dx": 0.08704623579978943,
      "pose_mae_dy": 0.0517381988465786,
      "pose_rmse_dtheta": 0.4136848449707031,
      "pose_rmse_dx": 0.190292090177536,
      "pose_rmse_dy": 0.1211860179901123,
      "pose_rmse_mean": 0.2417210042476654,
      "rmse_dtheta": 0.04727944731712341,
      "rmse_dx": 0.023259257897734642,
      "rmse_dy": 0.008821002207696438,
      "rmse_mean": 0.026453237980604172,
      "rotation_flip": 0.012864493764936924,
      "sparse_tokens": 17353.0,
      "step": 393,
      "turn_loss": 0.25012388825416565,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.01830514774205538,
      "grad_norm": 1.0012110471725464,
      "learning_rate": 9.986976025554588e-06,
      "loss": 0.2514,
      "mae_dtheta": 0.03712141886353493,
      "mae_dx": 0.01588689349591732,
      "mae_dy": 0.008711208589375019,
      "pose_mae_dtheta": 0.28844016790390015,
      "pose_mae_dx": 0.15308155119419098,
      "pose_mae_dy": 0.14237672090530396,
      "pose_rmse_dtheta": 0.5143387913703918,
      "pose_rmse_dx": 0.31922706961631775,
      "pose_rmse_dy": 0.26678648591041565,
      "pose_rmse_mean": 0.36678409576416016,
      "rmse_dtheta": 0.054227013140916824,
      "rmse_dx": 0.030853673815727234,
      "rmse_dy": 0.014263736084103584,
      "rmse_mean": 0.033114805817604065,
      "rotation_flip": 0.02979515865445137,
      "sparse_tokens": 9784.0,
      "step": 394,
      "turn_loss": 0.32013121247291565,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 37201.0,
      "epoch": 0.01835160750789816,
      "grad_norm": 0.6342698931694031,
      "learning_rate": 9.98688047889634e-06,
      "loss": 0.1429,
      "mae_dtheta": 0.04079657047986984,
      "mae_dx": 0.014547632075846195,
      "mae_dy": 0.007748306263238192,
      "pose_mae_dtheta": 0.327514111995697,
      "pose_mae_dx": 0.125494122505188,
      "pose_mae_dy": 0.08886290341615677,
      "pose_rmse_dtheta": 0.5276415944099426,
      "pose_rmse_dx": 0.26111310720443726,
      "pose_rmse_dy": 0.20720252394676208,
      "pose_rmse_mean": 0.3319857716560364,
      "rmse_dtheta": 0.057086456567049026,
      "rmse_dx": 0.027252767235040665,
      "rmse_dy": 0.016028814017772675,
      "rmse_mean": 0.03345601260662079,
      "rotation_flip": 0.01783723570406437,
      "sparse_tokens": 29701.0,
      "step": 395,
      "turn_loss": 0.33433982729911804,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.01839806727374094,
      "grad_norm": 0.6815133690834045,
      "learning_rate": 9.986784583502863e-06,
      "loss": 0.119,
      "mae_dtheta": 0.01175613235682249,
      "mae_dx": 0.0022123579401522875,
      "mae_dy": 0.0029613771475851536,
      "pose_mae_dtheta": 0.08072221279144287,
      "pose_mae_dx": 0.028578579425811768,
      "pose_mae_dy": 0.04162939637899399,
      "pose_rmse_dtheta": 0.15679685771465302,
      "pose_rmse_dx": 0.06942656636238098,
      "pose_rmse_dy": 0.09362241625785828,
      "pose_rmse_mean": 0.10661529004573822,
      "rmse_dtheta": 0.02226102352142334,
      "rmse_dx": 0.0071691302582621574,
      "rmse_dy": 0.006658823229372501,
      "rmse_mean": 0.012029659003019333,
      "rotation_flip": 0.0033003301359713078,
      "sparse_tokens": 32057.0,
      "step": 396,
      "turn_loss": 0.09383414685726166,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.01844452703958372,
      "grad_norm": 0.8858582377433777,
      "learning_rate": 9.986688339380863e-06,
      "loss": 0.181,
      "mae_dtheta": 0.013430865481495857,
      "mae_dx": 0.0029294448904693127,
      "mae_dy": 0.0032962928526103497,
      "pose_mae_dtheta": 0.09954383969306946,
      "pose_mae_dx": 0.03933823108673096,
      "pose_mae_dy": 0.03978675231337547,
      "pose_rmse_dtheta": 0.21218712627887726,
      "pose_rmse_dx": 0.09793708473443985,
      "pose_rmse_dy": 0.08707083016633987,
      "pose_rmse_mean": 0.1323983520269394,
      "rmse_dtheta": 0.026225106790661812,
      "rmse_dx": 0.008029217831790447,
      "rmse_dy": 0.006969904061406851,
      "rmse_mean": 0.01374140940606594,
      "rotation_flip": 0.002404809696599841,
      "sparse_tokens": 32089.0,
      "step": 397,
      "turn_loss": 0.1163988783955574,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.0184909868054265,
      "grad_norm": 1.0873602628707886,
      "learning_rate": 9.986591746537071e-06,
      "loss": 0.3201,
      "mae_dtheta": 0.032439008355140686,
      "mae_dx": 0.011239386163651943,
      "mae_dy": 0.006957957986742258,
      "pose_mae_dtheta": 0.26319587230682373,
      "pose_mae_dx": 0.09670428931713104,
      "pose_mae_dy": 0.0975489392876625,
      "pose_rmse_dtheta": 0.46949300169944763,
      "pose_rmse_dx": 0.21198175847530365,
      "pose_rmse_dy": 0.21189755201339722,
      "pose_rmse_mean": 0.2977907657623291,
      "rmse_dtheta": 0.04982177913188934,
      "rmse_dx": 0.02311781235039234,
      "rmse_dy": 0.013757957145571709,
      "rmse_mean": 0.028899183496832848,
      "rotation_flip": 0.014312976971268654,
      "sparse_tokens": 22969.0,
      "step": 398,
      "turn_loss": 0.2857796251773834,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.01853744657126928,
      "grad_norm": 0.7879496216773987,
      "learning_rate": 9.986494804978241e-06,
      "loss": 0.1495,
      "mae_dtheta": 0.041655607521533966,
      "mae_dx": 0.01859818771481514,
      "mae_dy": 0.00567487021908164,
      "pose_mae_dtheta": 0.30548959970474243,
      "pose_mae_dx": 0.14069963991641998,
      "pose_mae_dy": 0.090666264295578,
      "pose_rmse_dtheta": 0.5004156827926636,
      "pose_rmse_dx": 0.29020264744758606,
      "pose_rmse_dy": 0.1952829211950302,
      "pose_rmse_mean": 0.32863375544548035,
      "rmse_dtheta": 0.05732410028576851,
      "rmse_dx": 0.03292139619588852,
      "rmse_dy": 0.010864347219467163,
      "rmse_mean": 0.0337032824754715,
      "rotation_flip": 0.007547169923782349,
      "sparse_tokens": 5381.0,
      "step": 399,
      "turn_loss": 0.2626889646053314,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.01858390633711206,
      "grad_norm": 0.8460928797721863,
      "learning_rate": 9.986397514711154e-06,
      "loss": 0.1495,
      "mae_dtheta": 0.04526863619685173,
      "mae_dx": 0.007458142004907131,
      "mae_dy": 0.0067107961513102055,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.846092700958252,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 121.94940185546875,
      "model/head/act_norm_mean": 97.20025634765625,
      "model/head/act_norm_min": 75.20333099365234,
      "model/head/act_over_embed": 66.79692616524663,
      "model/head/grad_frac": 0.09325690567493439,
      "model/head/grad_norm": 0.07890398800373077,
      "model/head/grad_zero_frac": 0.0001687885815044865,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6945452008928571,
      "model/head/update_ratio": 0.0013811502140015364,
      "model/head/weight_delta": 2.281888246536255,
      "model/head/weight_delta_rel": 0.040031079202890396,
      "model/head/weight_norm": 57.129188537597656,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.40960705280303955,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.40960705280303955,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.40960705280303955,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2814858014878954,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08104267716407776,
      "model/modality_embedder.encoders.pose/grad_norm": 0.068569615483284,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.00223808316513896,
      "model/modality_embedder.encoders.pose/weight_delta": 0.673615038394928,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.022009102627635002,
      "model/modality_embedder.encoders.pose/weight_norm": 30.637653350830078,
      "model/modality_embedder/grad_frac": 0.08104267716407776,
      "model/modality_embedder/grad_norm": 0.068569615483284,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.00223808316513896,
      "model/modality_embedder/weight_delta": 0.673615038394928,
      "model/modality_embedder/weight_delta_rel": 0.022009102627635002,
      "model/modality_embedder/weight_norm": 30.637653350830078,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 68.79364776611328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.004842952806122,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.094181060791016,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.121934089753873,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06709812581539154,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.056771233677864075,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002066673943772912,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.2948017120361328,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.010742751881480217,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.46985626220703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 70.47637939453125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.950235172193878,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.72712230682373,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.771616473818545,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.070779949426651,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.059886399656534195,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0020705778151750565,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.33302971720695496,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.011536410078406334,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.92255401611328,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 72.39156341552734,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.673814838435373,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.9951171875,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.95607655686677,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07578003406524658,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.064116932451725,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0021486703772097826,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.3334450423717499,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.011196460574865341,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.840282440185547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 73.02879333496094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.6578443877551,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.531182289123535,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.319520237936576,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08732713758945465,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07388685643672943,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002521342597901821,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.2755623161792755,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.009417411871254444,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.304569244384766,
      "model/normalizer/grad_frac": 0.319685697555542,
      "model/normalizer/grad_norm": 0.27048373222351074,
      "model/normalizer/grad_zero_frac": 0.00019735030946321785,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003480932442471385,
      "model/normalizer/weight_delta": 0.6392536163330078,
      "model/normalizer/weight_delta_rel": 0.008233216591179371,
      "model/normalizer/weight_norm": 77.70439147949219,
      "pose_mae_dtheta": 0.3663471043109894,
      "pose_mae_dx": 0.06786063313484192,
      "pose_mae_dy": 0.10529736429452896,
      "pose_rmse_dtheta": 0.6264640092849731,
      "pose_rmse_dx": 0.15078476071357727,
      "pose_rmse_dy": 0.2196660339832306,
      "pose_rmse_mean": 0.3323049247264862,
      "rmse_dtheta": 0.06522268056869507,
      "rmse_dx": 0.018894584849476814,
      "rmse_dy": 0.011104247532784939,
      "rmse_mean": 0.03174050524830818,
      "rotation_flip": 0.010723860934376717,
      "sparse_tokens": 7117.0,
      "step": 400,
      "turn_loss": 0.3205454349517822,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "epoch": 0.01858390633711206,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3329651951789856,
      "eval_objectnav_nopose_mae_dtheta": 0.04111023619771004,
      "eval_objectnav_nopose_mae_dx": 0.015194754116237164,
      "eval_objectnav_nopose_mae_dy": 0.005372936371713877,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.33769214153289795,
      "eval_objectnav_nopose_pose_mae_dx": 0.12320869415998459,
      "eval_objectnav_nopose_pose_mae_dy": 0.06237877532839775,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5509902238845825,
      "eval_objectnav_nopose_pose_rmse_dx": 0.25627899169921875,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14068549871444702,
      "eval_objectnav_nopose_pose_rmse_mean": 0.31598490476608276,
      "eval_objectnav_nopose_rmse_dtheta": 0.05795058235526085,
      "eval_objectnav_nopose_rmse_dx": 0.028063859790563583,
      "eval_objectnav_nopose_rmse_dy": 0.010713689960539341,
      "eval_objectnav_nopose_rmse_mean": 0.03224271163344383,
      "eval_objectnav_nopose_rotation_flip": 0.014164834283292294,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3329651951789856,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 400
    },
    {
      "epoch": 0.01858390633711206,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.298507422208786,
      "eval_objectnav_pose_mae_dtheta": 0.03598193824291229,
      "eval_objectnav_pose_mae_dx": 0.012265045195817947,
      "eval_objectnav_pose_mae_dy": 0.005085242912173271,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27952122688293457,
      "eval_objectnav_pose_pose_mae_dx": 0.09681373834609985,
      "eval_objectnav_pose_pose_mae_dy": 0.05590621009469032,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4829598069190979,
      "eval_objectnav_pose_pose_rmse_dx": 0.2168237864971161,
      "eval_objectnav_pose_pose_rmse_dy": 0.13070397078990936,
      "eval_objectnav_pose_pose_rmse_mean": 0.27682918310165405,
      "eval_objectnav_pose_rmse_dtheta": 0.05312705785036087,
      "eval_objectnav_pose_rmse_dx": 0.02445444092154503,
      "eval_objectnav_pose_rmse_dy": 0.010682997293770313,
      "eval_objectnav_pose_rmse_mean": 0.029421498998999596,
      "eval_objectnav_pose_rotation_flip": 0.013496066443622112,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.298507422208786,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 400
    },
    {
      "epoch": 0.01858390633711206,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.11805734783411026,
      "eval_pointnav_mae_dtheta": 0.012775120325386524,
      "eval_pointnav_mae_dx": 0.003548672888427973,
      "eval_pointnav_mae_dy": 0.0032613370567560196,
      "eval_pointnav_pose_mae_dtheta": 0.09446339309215546,
      "eval_pointnav_pose_mae_dx": 0.04036744683980942,
      "eval_pointnav_pose_mae_dy": 0.03899098187685013,
      "eval_pointnav_pose_rmse_dtheta": 0.23569773137569427,
      "eval_pointnav_pose_rmse_dx": 0.10668334364891052,
      "eval_pointnav_pose_rmse_dy": 0.10821836441755295,
      "eval_pointnav_pose_rmse_mean": 0.15019981563091278,
      "eval_pointnav_rmse_dtheta": 0.02861475944519043,
      "eval_pointnav_rmse_dx": 0.009930167347192764,
      "eval_pointnav_rmse_dy": 0.008518612943589687,
      "eval_pointnav_rmse_mean": 0.0156878475099802,
      "eval_pointnav_rotation_flip": 0.004765872843563557,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.11805734783411026,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 400
    },
    {
      "epoch": 0.01858390633711206,
      "eval_loss": 0.2498433217406273,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3329651951789856,
      "eval_objectnav_nopose_mae_dtheta": 0.04111023619771004,
      "eval_objectnav_nopose_mae_dx": 0.015194754116237164,
      "eval_objectnav_nopose_mae_dy": 0.005372936371713877,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.33769214153289795,
      "eval_objectnav_nopose_pose_mae_dx": 0.12320869415998459,
      "eval_objectnav_nopose_pose_mae_dy": 0.06237877532839775,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5509902238845825,
      "eval_objectnav_nopose_pose_rmse_dx": 0.25627899169921875,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14068549871444702,
      "eval_objectnav_nopose_pose_rmse_mean": 0.31598490476608276,
      "eval_objectnav_nopose_rmse_dtheta": 0.05795058235526085,
      "eval_objectnav_nopose_rmse_dx": 0.028063859790563583,
      "eval_objectnav_nopose_rmse_dy": 0.010713689960539341,
      "eval_objectnav_nopose_rmse_mean": 0.03224271163344383,
      "eval_objectnav_nopose_rotation_flip": 0.014164834283292294,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3329651951789856,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.298507422208786,
      "eval_objectnav_pose_mae_dtheta": 0.03598193824291229,
      "eval_objectnav_pose_mae_dx": 0.012265045195817947,
      "eval_objectnav_pose_mae_dy": 0.005085242912173271,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27952122688293457,
      "eval_objectnav_pose_pose_mae_dx": 0.09681373834609985,
      "eval_objectnav_pose_pose_mae_dy": 0.05590621009469032,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4829598069190979,
      "eval_objectnav_pose_pose_rmse_dx": 0.2168237864971161,
      "eval_objectnav_pose_pose_rmse_dy": 0.13070397078990936,
      "eval_objectnav_pose_pose_rmse_mean": 0.27682918310165405,
      "eval_objectnav_pose_rmse_dtheta": 0.05312705785036087,
      "eval_objectnav_pose_rmse_dx": 0.02445444092154503,
      "eval_objectnav_pose_rmse_dy": 0.010682997293770313,
      "eval_objectnav_pose_rmse_mean": 0.029421498998999596,
      "eval_objectnav_pose_rotation_flip": 0.013496066443622112,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.298507422208786,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.11805734783411026,
      "eval_pointnav_mae_dtheta": 0.012775120325386524,
      "eval_pointnav_mae_dx": 0.003548672888427973,
      "eval_pointnav_mae_dy": 0.0032613370567560196,
      "eval_pointnav_pose_mae_dtheta": 0.09446339309215546,
      "eval_pointnav_pose_mae_dx": 0.04036744683980942,
      "eval_pointnav_pose_mae_dy": 0.03899098187685013,
      "eval_pointnav_pose_rmse_dtheta": 0.23569773137569427,
      "eval_pointnav_pose_rmse_dx": 0.10668334364891052,
      "eval_pointnav_pose_rmse_dy": 0.10821836441755295,
      "eval_pointnav_pose_rmse_mean": 0.15019981563091278,
      "eval_pointnav_rmse_dtheta": 0.02861475944519043,
      "eval_pointnav_rmse_dx": 0.009930167347192764,
      "eval_pointnav_rmse_dy": 0.008518612943589687,
      "eval_pointnav_rmse_mean": 0.0156878475099802,
      "eval_pointnav_rotation_flip": 0.004765872843563557,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.11805734783411026,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 400
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.01863036610295484,
      "grad_norm": 0.6819506883621216,
      "learning_rate": 9.986299875742612e-06,
      "loss": 0.1638,
      "mae_dtheta": 0.036185119301080704,
      "mae_dx": 0.014440717175602913,
      "mae_dy": 0.007177960127592087,
      "pose_mae_dtheta": 0.3275994658470154,
      "pose_mae_dx": 0.14954246580600739,
      "pose_mae_dy": 0.07529345154762268,
      "pose_rmse_dtheta": 0.49448010325431824,
      "pose_rmse_dx": 0.28282222151756287,
      "pose_rmse_dy": 0.15324822068214417,
      "pose_rmse_mean": 0.3101835250854492,
      "rmse_dtheta": 0.052244819700717926,
      "rmse_dx": 0.025410953909158707,
      "rmse_dy": 0.013817885890603065,
      "rmse_mean": 0.030491221696138382,
      "rotation_flip": 0.017241379246115685,
      "sparse_tokens": 5657.0,
      "step": 401,
      "turn_loss": 0.2771781086921692,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.01867682586879762,
      "grad_norm": 0.5178663730621338,
      "learning_rate": 9.986201888079444e-06,
      "loss": 0.102,
      "mae_dtheta": 0.009836023673415184,
      "mae_dx": 0.0022185787092894316,
      "mae_dy": 0.0017152426298707724,
      "pose_mae_dtheta": 0.07312365621328354,
      "pose_mae_dx": 0.02352968603372574,
      "pose_mae_dy": 0.021590013056993484,
      "pose_rmse_dtheta": 0.23691865801811218,
      "pose_rmse_dx": 0.0671127662062645,
      "pose_rmse_dy": 0.0558156818151474,
      "pose_rmse_mean": 0.11994904279708862,
      "rmse_dtheta": 0.02673058770596981,
      "rmse_dx": 0.006670153699815273,
      "rmse_dy": 0.004503983072936535,
      "rmse_mean": 0.01263490878045559,
      "rotation_flip": 0.004825737327337265,
      "sparse_tokens": 32105.0,
      "step": 402,
      "turn_loss": 0.07170861959457397,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.018723285634640402,
      "grad_norm": 0.9021960496902466,
      "learning_rate": 9.9861035517285e-06,
      "loss": 0.1354,
      "mae_dtheta": 0.0406276173889637,
      "mae_dx": 0.025782784447073936,
      "mae_dy": 0.0036742326337844133,
      "pose_mae_dtheta": 0.3397473692893982,
      "pose_mae_dx": 0.222804993391037,
      "pose_mae_dy": 0.035564180463552475,
      "pose_rmse_dtheta": 0.519694983959198,
      "pose_rmse_dx": 0.3695363998413086,
      "pose_rmse_dy": 0.059614479541778564,
      "pose_rmse_mean": 0.3162819743156433,
      "rmse_dtheta": 0.0548911988735199,
      "rmse_dx": 0.03713986277580261,
      "rmse_dy": 0.006905874703079462,
      "rmse_mean": 0.032978981733322144,
      "rotation_flip": 0.027210883796215057,
      "sparse_tokens": 3368.0,
      "step": 403,
      "turn_loss": 0.354324072599411,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.018769745400483182,
      "grad_norm": 0.6607874035835266,
      "learning_rate": 9.986004866696661e-06,
      "loss": 0.1529,
      "mae_dtheta": 0.029262425377964973,
      "mae_dx": 0.012366756796836853,
      "mae_dy": 0.006766794715076685,
      "pose_mae_dtheta": 0.21572653949260712,
      "pose_mae_dx": 0.11516030132770538,
      "pose_mae_dy": 0.07989008724689484,
      "pose_rmse_dtheta": 0.40266308188438416,
      "pose_rmse_dx": 0.25310391187667847,
      "pose_rmse_dy": 0.20381318032741547,
      "pose_rmse_mean": 0.28652673959732056,
      "rmse_dtheta": 0.04698463901877403,
      "rmse_dx": 0.025553060695528984,
      "rmse_dy": 0.015700729563832283,
      "rmse_mean": 0.029412809759378433,
      "rotation_flip": 0.01278409082442522,
      "sparse_tokens": 13138.0,
      "step": 404,
      "turn_loss": 0.24946314096450806,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.018816205166325962,
      "grad_norm": 0.7298672199249268,
      "learning_rate": 9.985905832990826e-06,
      "loss": 0.1589,
      "mae_dtheta": 0.014285868965089321,
      "mae_dx": 0.002261062152683735,
      "mae_dy": 0.0019816290587186813,
      "pose_mae_dtheta": 0.10468385368585587,
      "pose_mae_dx": 0.027126731351017952,
      "pose_mae_dy": 0.029905518516898155,
      "pose_rmse_dtheta": 0.2775075435638428,
      "pose_rmse_dx": 0.06716204434633255,
      "pose_rmse_dy": 0.07323972880840302,
      "pose_rmse_mean": 0.13930311799049377,
      "rmse_dtheta": 0.03195391595363617,
      "rmse_dx": 0.007216259371489286,
      "rmse_dy": 0.00422896770760417,
      "rmse_mean": 0.014466381631791592,
      "rotation_flip": 0.0038071065209805965,
      "sparse_tokens": 32121.0,
      "step": 405,
      "turn_loss": 0.09971015900373459,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.018862664932168743,
      "grad_norm": 0.5213531255722046,
      "learning_rate": 9.985806450617916e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.009078672155737877,
      "mae_dx": 0.0015957881696522236,
      "mae_dy": 0.0016553638270124793,
      "pose_mae_dtheta": 0.059534333646297455,
      "pose_mae_dx": 0.016490908339619637,
      "pose_mae_dy": 0.022340428084135056,
      "pose_rmse_dtheta": 0.1845937818288803,
      "pose_rmse_dx": 0.03980414941906929,
      "pose_rmse_dy": 0.056471023708581924,
      "pose_rmse_mean": 0.09362298250198364,
      "rmse_dtheta": 0.02394860051572323,
      "rmse_dx": 0.00463730376213789,
      "rmse_dy": 0.0038957756478339434,
      "rmse_mean": 0.01082722656428814,
      "rotation_flip": 0.007045561447739601,
      "sparse_tokens": 32121.0,
      "step": 406,
      "turn_loss": 0.07399322837591171,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.018909124698011523,
      "grad_norm": 0.6806410551071167,
      "learning_rate": 9.985706719584888e-06,
      "loss": 0.1208,
      "mae_dtheta": 0.011794271878898144,
      "mae_dx": 0.003261781297624111,
      "mae_dy": 0.0025377669371664524,
      "pose_mae_dtheta": 0.09204551577568054,
      "pose_mae_dx": 0.03531699255108833,
      "pose_mae_dy": 0.037869829684495926,
      "pose_rmse_dtheta": 0.21079115569591522,
      "pose_rmse_dx": 0.09219575673341751,
      "pose_rmse_dy": 0.1000613272190094,
      "pose_rmse_mean": 0.13434942066669464,
      "rmse_dtheta": 0.024028664454817772,
      "rmse_dx": 0.009538534097373486,
      "rmse_dy": 0.00589067442342639,
      "rmse_mean": 0.013152624480426311,
      "rotation_flip": 0.00626398203894496,
      "sparse_tokens": 32137.0,
      "step": 407,
      "turn_loss": 0.08560844510793686,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.018955584463854303,
      "grad_norm": 0.6317679286003113,
      "learning_rate": 9.985606639898714e-06,
      "loss": 0.1459,
      "mae_dtheta": 0.007384053897112608,
      "mae_dx": 0.002445922000333667,
      "mae_dy": 0.001042746240273118,
      "pose_mae_dtheta": 0.06015274301171303,
      "pose_mae_dx": 0.021943390369415283,
      "pose_mae_dy": 0.016674762591719627,
      "pose_rmse_dtheta": 0.1411183923482895,
      "pose_rmse_dx": 0.05292870104312897,
      "pose_rmse_dy": 0.04376723989844322,
      "pose_rmse_mean": 0.07927145063877106,
      "rmse_dtheta": 0.018005620688199997,
      "rmse_dx": 0.006690626963973045,
      "rmse_dy": 0.0023637020494788885,
      "rmse_mean": 0.009019983932375908,
      "rotation_flip": 0.001640016445890069,
      "sparse_tokens": 32201.0,
      "step": 408,
      "turn_loss": 0.06103796511888504,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.019002044229697083,
      "grad_norm": 0.6273964643478394,
      "learning_rate": 9.985506211566388e-06,
      "loss": 0.1408,
      "mae_dtheta": 0.013154816813766956,
      "mae_dx": 0.002218435285612941,
      "mae_dy": 0.0033720647916197777,
      "pose_mae_dtheta": 0.09797969460487366,
      "pose_mae_dx": 0.0318525992333889,
      "pose_mae_dy": 0.04520649462938309,
      "pose_rmse_dtheta": 0.22494666278362274,
      "pose_rmse_dx": 0.07926302403211594,
      "pose_rmse_dy": 0.1117226853966713,
      "pose_rmse_mean": 0.13864412903785706,
      "rmse_dtheta": 0.026739900931715965,
      "rmse_dx": 0.006274298764765263,
      "rmse_dy": 0.007272446062415838,
      "rmse_mean": 0.013428881764411926,
      "rotation_flip": 0.006557377055287361,
      "sparse_tokens": 32089.0,
      "step": 409,
      "turn_loss": 0.10180555284023285,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.019048503995539864,
      "grad_norm": 0.4832080006599426,
      "learning_rate": 9.98540543459494e-06,
      "loss": 0.132,
      "mae_dtheta": 0.00911111943423748,
      "mae_dx": 0.0020936946384608746,
      "mae_dy": 0.0017823406960815191,
      "pose_mae_dtheta": 0.0643591657280922,
      "pose_mae_dx": 0.02240108698606491,
      "pose_mae_dy": 0.024347888305783272,
      "pose_rmse_dtheta": 0.1613004356622696,
      "pose_rmse_dx": 0.07274739444255829,
      "pose_rmse_dy": 0.060814663767814636,
      "pose_rmse_mean": 0.09828750789165497,
      "rmse_dtheta": 0.021884551271796227,
      "rmse_dx": 0.007004392798990011,
      "rmse_dy": 0.004276235122233629,
      "rmse_mean": 0.011055059731006622,
      "rotation_flip": 0.006369426846504211,
      "sparse_tokens": 32057.0,
      "step": 410,
      "turn_loss": 0.06250232458114624,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.019094963761382644,
      "grad_norm": 0.493410587310791,
      "learning_rate": 9.985304308991412e-06,
      "loss": 0.1055,
      "mae_dtheta": 0.035550013184547424,
      "mae_dx": 0.011005830951035023,
      "mae_dy": 0.0057021924294531345,
      "pose_mae_dtheta": 0.2651035189628601,
      "pose_mae_dx": 0.1061706617474556,
      "pose_mae_dy": 0.07251912355422974,
      "pose_rmse_dtheta": 0.4714464843273163,
      "pose_rmse_dx": 0.2496255785226822,
      "pose_rmse_dy": 0.15677344799041748,
      "pose_rmse_mean": 0.2926151752471924,
      "rmse_dtheta": 0.05510248616337776,
      "rmse_dx": 0.025034980848431587,
      "rmse_dy": 0.011255860328674316,
      "rmse_mean": 0.030464444309473038,
      "rotation_flip": 0.013620885089039803,
      "sparse_tokens": 14162.0,
      "step": 411,
      "turn_loss": 0.29783621430397034,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 36551.0,
      "epoch": 0.019141423527225424,
      "grad_norm": 0.544899582862854,
      "learning_rate": 9.985202834762878e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.03782089799642563,
      "mae_dx": 0.01584804616868496,
      "mae_dy": 0.006720646284520626,
      "pose_mae_dtheta": 0.31401392817497253,
      "pose_mae_dx": 0.1194925457239151,
      "pose_mae_dy": 0.0861920714378357,
      "pose_rmse_dtheta": 0.5243512392044067,
      "pose_rmse_dx": 0.23516985774040222,
      "pose_rmse_dy": 0.19565284252166748,
      "pose_rmse_mean": 0.3183913230895996,
      "rmse_dtheta": 0.05454254150390625,
      "rmse_dx": 0.028412561863660812,
      "rmse_dy": 0.013877900317311287,
      "rmse_mean": 0.0322776697576046,
      "rotation_flip": 0.006148686632514,
      "sparse_tokens": 28554.0,
      "step": 412,
      "turn_loss": 0.3294394910335541,
      "turns": 113.0,
      "turns_per_sample": 113.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.019187883293068204,
      "grad_norm": 0.5098153948783875,
      "learning_rate": 9.985101011916435e-06,
      "loss": 0.0868,
      "mae_dtheta": 0.007906435057520866,
      "mae_dx": 0.002161567099392414,
      "mae_dy": 0.0004214502405375242,
      "pose_mae_dtheta": 0.05897950753569603,
      "pose_mae_dx": 0.01733897067606449,
      "pose_mae_dy": 0.006464188918471336,
      "pose_rmse_dtheta": 0.24609217047691345,
      "pose_rmse_dx": 0.044827651232481,
      "pose_rmse_dy": 0.012425174936652184,
      "pose_rmse_mean": 0.10111500322818756,
      "rmse_dtheta": 0.02810477465391159,
      "rmse_dx": 0.006446789484471083,
      "rmse_dy": 0.0006324774003587663,
      "rmse_mean": 0.0117280138656497,
      "rotation_flip": 0.0,
      "sparse_tokens": 32169.0,
      "step": 413,
      "turn_loss": 0.05292849242687225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.019234343058910985,
      "grad_norm": 0.5178439617156982,
      "learning_rate": 9.984998840459202e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.012652425095438957,
      "mae_dx": 0.0030759002547711134,
      "mae_dy": 0.003430248936638236,
      "pose_mae_dtheta": 0.0882461741566658,
      "pose_mae_dx": 0.03463752567768097,
      "pose_mae_dy": 0.039108868688344955,
      "pose_rmse_dtheta": 0.19507098197937012,
      "pose_rmse_dx": 0.09253239631652832,
      "pose_rmse_dy": 0.09678377211093903,
      "pose_rmse_mean": 0.1281290501356125,
      "rmse_dtheta": 0.02566961944103241,
      "rmse_dx": 0.010317722335457802,
      "rmse_dy": 0.009108693338930607,
      "rmse_mean": 0.015032011084258556,
      "rotation_flip": 0.002922755666077137,
      "sparse_tokens": 32057.0,
      "step": 414,
      "turn_loss": 0.1288640797138214,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.019280802824753765,
      "grad_norm": 0.5496065020561218,
      "learning_rate": 9.984896320398326e-06,
      "loss": 0.1195,
      "mae_dtheta": 0.04169496148824692,
      "mae_dx": 0.009779228828847408,
      "mae_dy": 0.0033904165029525757,
      "pose_mae_dtheta": 0.3451150059700012,
      "pose_mae_dx": 0.08705948293209076,
      "pose_mae_dy": 0.03935528174042702,
      "pose_rmse_dtheta": 0.6120291352272034,
      "pose_rmse_dx": 0.202480748295784,
      "pose_rmse_dy": 0.10539383441209793,
      "pose_rmse_mean": 0.3066345751285553,
      "rmse_dtheta": 0.06465446203947067,
      "rmse_dx": 0.021390656009316444,
      "rmse_dy": 0.00844039861112833,
      "rmse_mean": 0.031495172530412674,
      "rotation_flip": 0.014516129158437252,
      "sparse_tokens": 10812.0,
      "step": 415,
      "turn_loss": 0.2510009706020355,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.01932726259059654,
      "grad_norm": 0.4304061830043793,
      "learning_rate": 9.984793451740972e-06,
      "loss": 0.146,
      "mae_dtheta": 0.01494439784437418,
      "mae_dx": 0.003842862555757165,
      "mae_dy": 0.0032805190421640873,
      "pose_mae_dtheta": 0.10537467151880264,
      "pose_mae_dx": 0.04076334834098816,
      "pose_mae_dy": 0.03616074472665787,
      "pose_rmse_dtheta": 0.2452717423439026,
      "pose_rmse_dx": 0.10873757302761078,
      "pose_rmse_dy": 0.07623053342103958,
      "pose_rmse_mean": 0.14341329038143158,
      "rmse_dtheta": 0.02951928973197937,
      "rmse_dx": 0.010624948889017105,
      "rmse_dy": 0.0076688556000590324,
      "rmse_mean": 0.015937699005007744,
      "rotation_flip": 0.004756677430123091,
      "sparse_tokens": 32089.0,
      "step": 416,
      "turn_loss": 0.15187422931194305,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.019373722356439322,
      "grad_norm": 0.6013463139533997,
      "learning_rate": 9.984690234494338e-06,
      "loss": 0.1614,
      "mae_dtheta": 0.036194924265146255,
      "mae_dx": 0.013021805323660374,
      "mae_dy": 0.005145397037267685,
      "pose_mae_dtheta": 0.2747792601585388,
      "pose_mae_dx": 0.111143559217453,
      "pose_mae_dy": 0.06912195682525635,
      "pose_rmse_dtheta": 0.47310295701026917,
      "pose_rmse_dx": 0.2494867444038391,
      "pose_rmse_dy": 0.14242921769618988,
      "pose_rmse_mean": 0.28833967447280884,
      "rmse_dtheta": 0.053488533943891525,
      "rmse_dx": 0.026345636695623398,
      "rmse_dy": 0.009316664189100266,
      "rmse_mean": 0.029716944321990013,
      "rotation_flip": 0.012820512987673283,
      "sparse_tokens": 11503.0,
      "step": 417,
      "turn_loss": 0.26400983333587646,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.019420182122282102,
      "grad_norm": 0.9558333158493042,
      "learning_rate": 9.984586668665641e-06,
      "loss": 0.1414,
      "mae_dtheta": 0.01177877839654684,
      "mae_dx": 0.0035769951064139605,
      "mae_dy": 0.003611118532717228,
      "pose_mae_dtheta": 0.08469752967357635,
      "pose_mae_dx": 0.04366012290120125,
      "pose_mae_dy": 0.03827459365129471,
      "pose_rmse_dtheta": 0.18225151300430298,
      "pose_rmse_dx": 0.11910978704690933,
      "pose_rmse_dy": 0.08508739620447159,
      "pose_rmse_mean": 0.12881623208522797,
      "rmse_dtheta": 0.023708537220954895,
      "rmse_dx": 0.010749569162726402,
      "rmse_dy": 0.0081059280782938,
      "rmse_mean": 0.014188012108206749,
      "rotation_flip": 0.007020622957497835,
      "sparse_tokens": 32073.0,
      "step": 418,
      "turn_loss": 0.10969389230012894,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.019466641888124882,
      "grad_norm": 0.5697607398033142,
      "learning_rate": 9.984482754262121e-06,
      "loss": 0.1778,
      "mae_dtheta": 0.02951212413609028,
      "mae_dx": 0.012293240986764431,
      "mae_dy": 0.00552373705431819,
      "pose_mae_dtheta": 0.25023096799850464,
      "pose_mae_dx": 0.11363405734300613,
      "pose_mae_dy": 0.0653187483549118,
      "pose_rmse_dtheta": 0.4573500156402588,
      "pose_rmse_dx": 0.23774665594100952,
      "pose_rmse_dy": 0.20588628947734833,
      "pose_rmse_mean": 0.3003276586532593,
      "rmse_dtheta": 0.04783300682902336,
      "rmse_dx": 0.024391181766986847,
      "rmse_dy": 0.01198638416826725,
      "rmse_mean": 0.02807018905878067,
      "rotation_flip": 0.00638977624475956,
      "sparse_tokens": 11209.0,
      "step": 419,
      "turn_loss": 0.3082086741924286,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.019513101653967663,
      "grad_norm": 0.7051051259040833,
      "learning_rate": 9.98437849129105e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.02647825889289379,
      "mae_dx": 0.0076400707475841045,
      "mae_dy": 0.0032211507204920053,
      "pose_mae_dtheta": 0.2297222912311554,
      "pose_mae_dx": 0.06525254994630814,
      "pose_mae_dy": 0.0534912534058094,
      "pose_rmse_dtheta": 0.43160295486450195,
      "pose_rmse_dx": 0.16793251037597656,
      "pose_rmse_dy": 0.11785590648651123,
      "pose_rmse_mean": 0.23913046717643738,
      "rmse_dtheta": 0.044550180435180664,
      "rmse_dx": 0.019127851352095604,
      "rmse_dy": 0.0059537505730986595,
      "rmse_mean": 0.023210596293210983,
      "rotation_flip": 0.0052770450711250305,
      "sparse_tokens": 6926.0,
      "step": 420,
      "turn_loss": 0.21277739107608795,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.019559561419810443,
      "grad_norm": 0.5510096549987793,
      "learning_rate": 9.984273879759713e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.010761171579360962,
      "mae_dx": 0.0024674786254763603,
      "mae_dy": 0.0024553309194743633,
      "pose_mae_dtheta": 0.08027501404285431,
      "pose_mae_dx": 0.0274097491055727,
      "pose_mae_dy": 0.02990560792386532,
      "pose_rmse_dtheta": 0.1821620911359787,
      "pose_rmse_dx": 0.07277016341686249,
      "pose_rmse_dy": 0.08185117691755295,
      "pose_rmse_mean": 0.11226114630699158,
      "rmse_dtheta": 0.024434290826320648,
      "rmse_dx": 0.0073259309865534306,
      "rmse_dy": 0.006637125741690397,
      "rmse_mean": 0.012799116782844067,
      "rotation_flip": 0.004136504605412483,
      "sparse_tokens": 32089.0,
      "step": 421,
      "turn_loss": 0.08786474168300629,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.019606021185653223,
      "grad_norm": 0.5926405191421509,
      "learning_rate": 9.984168919675429e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.009193195961415768,
      "mae_dx": 0.0028791639488190413,
      "mae_dy": 0.002122916281223297,
      "pose_mae_dtheta": 0.06547000259160995,
      "pose_mae_dx": 0.031201627105474472,
      "pose_mae_dy": 0.025909913703799248,
      "pose_rmse_dtheta": 0.16316352784633636,
      "pose_rmse_dx": 0.079722099006176,
      "pose_rmse_dy": 0.07095994800329208,
      "pose_rmse_mean": 0.10461519658565521,
      "rmse_dtheta": 0.022452333942055702,
      "rmse_dx": 0.007927038706839085,
      "rmse_dy": 0.00544340955093503,
      "rmse_mean": 0.011940928176045418,
      "rotation_flip": 0.0009233610471710563,
      "sparse_tokens": 32153.0,
      "step": 422,
      "turn_loss": 0.08917080610990524,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.019652480951496003,
      "grad_norm": 0.9294744729995728,
      "learning_rate": 9.984063611045537e-06,
      "loss": 0.2488,
      "mae_dtheta": 0.029546456411480904,
      "mae_dx": 0.007316203787922859,
      "mae_dy": 0.005074457731097937,
      "pose_mae_dtheta": 0.23149162530899048,
      "pose_mae_dx": 0.06003087759017944,
      "pose_mae_dy": 0.06090615317225456,
      "pose_rmse_dtheta": 0.44021785259246826,
      "pose_rmse_dx": 0.1593935191631317,
      "pose_rmse_dy": 0.14870484173297882,
      "pose_rmse_mean": 0.24943874776363373,
      "rmse_dtheta": 0.04896311089396477,
      "rmse_dx": 0.017285721376538277,
      "rmse_dy": 0.0107713108882308,
      "rmse_mean": 0.025673381984233856,
      "rotation_flip": 0.014059754088521004,
      "sparse_tokens": 11286.0,
      "step": 423,
      "turn_loss": 0.26110386848449707,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 33413.0,
      "epoch": 0.019698940717338784,
      "grad_norm": 0.6451229453086853,
      "learning_rate": 9.9839579538774e-06,
      "loss": 0.1547,
      "mae_dtheta": 0.03102191723883152,
      "mae_dx": 0.010182122699916363,
      "mae_dy": 0.00580288702622056,
      "pose_mae_dtheta": 0.23938027024269104,
      "pose_mae_dx": 0.07806487381458282,
      "pose_mae_dy": 0.06667410582304001,
      "pose_rmse_dtheta": 0.40402305126190186,
      "pose_rmse_dx": 0.1810721457004547,
      "pose_rmse_dy": 0.1556592732667923,
      "pose_rmse_mean": 0.24691814184188843,
      "rmse_dtheta": 0.04703408479690552,
      "rmse_dx": 0.021929137408733368,
      "rmse_dy": 0.01228917483240366,
      "rmse_mean": 0.02708413265645504,
      "rotation_flip": 0.008124999701976776,
      "sparse_tokens": 26570.0,
      "step": 424,
      "turn_loss": 0.274858295917511,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 23367.0,
      "epoch": 0.019745400483181564,
      "grad_norm": 0.44965967535972595,
      "learning_rate": 9.98385194817841e-06,
      "loss": 0.1467,
      "mae_dtheta": 0.029932191595435143,
      "mae_dx": 0.014210676774382591,
      "mae_dy": 0.008308079093694687,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44965970516204834,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.6197052001953,
      "model/head/act_norm_mean": 95.36520724826389,
      "model/head/act_norm_min": 68.5481185913086,
      "model/head/act_over_embed": 65.53586324414385,
      "model/head/grad_frac": 0.11049291491508484,
      "model/head/grad_norm": 0.04968421161174774,
      "model/head/grad_zero_frac": 0.00019702577264979482,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6781005859375,
      "model/head/update_ratio": 0.0008695489377714694,
      "model/head/weight_delta": 2.353452682495117,
      "model/head/weight_delta_rel": 0.04128653183579445,
      "model/head/weight_norm": 57.13791275024414,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.40986496210098267,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4098029985819777,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4097507894039154,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.281620457261655,
      "model/modality_embedder.encoders.pose/grad_frac": 0.13172805309295654,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05923279747366905,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5236515410958904,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019331875955685973,
      "model/modality_embedder.encoders.pose/weight_delta": 0.6835917234420776,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.022335072979331017,
      "model/modality_embedder.encoders.pose/weight_norm": 30.639963150024414,
      "model/modality_embedder/grad_frac": 0.13172805309295654,
      "model/modality_embedder/grad_norm": 0.05923279747366905,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5236515410958904,
      "model/modality_embedder/update_ratio": 0.0019331875955685973,
      "model/modality_embedder/weight_delta": 0.6835917234420776,
      "model/modality_embedder/weight_delta_rel": 0.022335072979331017,
      "model/modality_embedder/weight_norm": 30.639963150024414,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.30132293701172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.88369777888007,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.045008659362793,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.038681992052902,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1048019528388977,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04712521657347679,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017154102679342031,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.30652642250061035,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.011170008219778538,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.471689224243164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.69788360595703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.817825451940035,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.690353393554688,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.680623274420771,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10220378637313843,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04595692455768585,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001588793471455574,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.3468050956726074,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.012013599276542664,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.925676345825195,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.35388946533203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.56384169697972,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.93330192565918,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.88050198447367,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11164996027946472,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05020448938012123,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016822157194837928,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.3485942482948303,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.011705142445862293,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.844263076782227,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.63153076171875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.629324776785715,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.458379745483398,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.29992129427361,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12191154807806015,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.054818712174892426,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018705219263210893,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.2891213893890381,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.009880797006189823,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.306640625,
      "model/normalizer/grad_frac": 0.5097126364707947,
      "model/normalizer/grad_norm": 0.22919723391532898,
      "model/normalizer/grad_zero_frac": 0.00016780685109551996,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0029494729824364185,
      "model/normalizer/weight_delta": 0.6671411395072937,
      "model/normalizer/weight_delta_rel": 0.008592391386628151,
      "model/normalizer/weight_norm": 77.7078628540039,
      "pose_mae_dtheta": 0.22791635990142822,
      "pose_mae_dx": 0.11722543090581894,
      "pose_mae_dy": 0.09673690050840378,
      "pose_rmse_dtheta": 0.4252600073814392,
      "pose_rmse_dx": 0.24971485137939453,
      "pose_rmse_dy": 0.21506108343601227,
      "pose_rmse_mean": 0.29667866230010986,
      "rmse_dtheta": 0.04785365238785744,
      "rmse_dx": 0.027308907359838486,
      "rmse_dy": 0.016787510365247726,
      "rmse_mean": 0.030650025233626366,
      "rotation_flip": 0.010638297535479069,
      "sparse_tokens": 19786.0,
      "step": 425,
      "turn_loss": 0.25622621178627014,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.019791860249024344,
      "grad_norm": 0.8396197557449341,
      "learning_rate": 9.98374559395598e-06,
      "loss": 0.1589,
      "mae_dtheta": 0.04320778325200081,
      "mae_dx": 0.01171932090073824,
      "mae_dy": 0.002266540192067623,
      "pose_mae_dtheta": 0.3558308184146881,
      "pose_mae_dx": 0.0950050950050354,
      "pose_mae_dy": 0.04018840566277504,
      "pose_rmse_dtheta": 0.6894922852516174,
      "pose_rmse_dx": 0.26491349935531616,
      "pose_rmse_dy": 0.10046535730361938,
      "pose_rmse_mean": 0.3516237139701843,
      "rmse_dtheta": 0.06810474395751953,
      "rmse_dx": 0.02716827020049095,
      "rmse_dy": 0.005012933164834976,
      "rmse_mean": 0.033428650349378586,
      "rotation_flip": 0.0043290043249726295,
      "sparse_tokens": 8066.0,
      "step": 426,
      "turn_loss": 0.2094878852367401,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.019838320014867124,
      "grad_norm": 0.5463268160820007,
      "learning_rate": 9.983638891217544e-06,
      "loss": 0.1158,
      "mae_dtheta": 0.011709567159414291,
      "mae_dx": 0.0017579483101144433,
      "mae_dy": 0.00264383084140718,
      "pose_mae_dtheta": 0.0838947743177414,
      "pose_mae_dx": 0.028247524052858353,
      "pose_mae_dy": 0.04179491475224495,
      "pose_rmse_dtheta": 0.17878231406211853,
      "pose_rmse_dx": 0.07093555480241776,
      "pose_rmse_dy": 0.10026468336582184,
      "pose_rmse_mean": 0.11666085571050644,
      "rmse_dtheta": 0.022649697959423065,
      "rmse_dx": 0.0054986015893518925,
      "rmse_dy": 0.005943570286035538,
      "rmse_mean": 0.011363956145942211,
      "rotation_flip": 0.004161464981734753,
      "sparse_tokens": 32057.0,
      "step": 427,
      "turn_loss": 0.0969301089644432,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.019884779780709905,
      "grad_norm": 0.4612007439136505,
      "learning_rate": 9.983531839970566e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.01020803302526474,
      "mae_dx": 0.002585111651569605,
      "mae_dy": 0.000404505233746022,
      "pose_mae_dtheta": 0.07868251204490662,
      "pose_mae_dx": 0.02039157599210739,
      "pose_mae_dy": 0.006492053158581257,
      "pose_rmse_dtheta": 0.26891249418258667,
      "pose_rmse_dx": 0.06833149492740631,
      "pose_rmse_dy": 0.01967400684952736,
      "pose_rmse_mean": 0.11897265911102295,
      "rmse_dtheta": 0.03198827803134918,
      "rmse_dx": 0.007613378576934338,
      "rmse_dy": 0.0007821356412023306,
      "rmse_mean": 0.013461264781653881,
      "rotation_flip": 0.0026539277750998735,
      "sparse_tokens": 32249.0,
      "step": 428,
      "turn_loss": 0.06085900217294693,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.019931239546552685,
      "grad_norm": 0.5653561949729919,
      "learning_rate": 9.98342444022253e-06,
      "loss": 0.1336,
      "mae_dtheta": 0.008695684373378754,
      "mae_dx": 0.0023136157542467117,
      "mae_dy": 0.0020037470385432243,
      "pose_mae_dtheta": 0.05955023318529129,
      "pose_mae_dx": 0.02199121192097664,
      "pose_mae_dy": 0.019119445234537125,
      "pose_rmse_dtheta": 0.1636408567428589,
      "pose_rmse_dx": 0.05673233047127724,
      "pose_rmse_dy": 0.045884907245635986,
      "pose_rmse_mean": 0.08875270187854767,
      "rmse_dtheta": 0.021527424454689026,
      "rmse_dx": 0.006077570840716362,
      "rmse_dy": 0.006062478292733431,
      "rmse_mean": 0.011222491972148418,
      "rotation_flip": 0.004817342385649681,
      "sparse_tokens": 32169.0,
      "step": 429,
      "turn_loss": 0.07949218153953552,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.019977699312395465,
      "grad_norm": 0.6098209619522095,
      "learning_rate": 9.98331669198095e-06,
      "loss": 0.1213,
      "mae_dtheta": 0.013623383827507496,
      "mae_dx": 0.0034659048542380333,
      "mae_dy": 0.002593414392322302,
      "pose_mae_dtheta": 0.09565775096416473,
      "pose_mae_dx": 0.03697807714343071,
      "pose_mae_dy": 0.03339971974492073,
      "pose_rmse_dtheta": 0.2310219258069992,
      "pose_rmse_dx": 0.10657024383544922,
      "pose_rmse_dy": 0.07923201471567154,
      "pose_rmse_mean": 0.13894140720367432,
      "rmse_dtheta": 0.0290400218218565,
      "rmse_dx": 0.010557541623711586,
      "rmse_dy": 0.007132102735340595,
      "rmse_mean": 0.015576555393636227,
      "rotation_flip": 0.0029749255627393723,
      "sparse_tokens": 32105.0,
      "step": 430,
      "turn_loss": 0.09973138570785522,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.020024159078238245,
      "grad_norm": 0.4895614683628082,
      "learning_rate": 9.983208595253359e-06,
      "loss": 0.128,
      "mae_dtheta": 0.012447577901184559,
      "mae_dx": 0.0030663516372442245,
      "mae_dy": 0.0028624124825000763,
      "pose_mae_dtheta": 0.089564748108387,
      "pose_mae_dx": 0.029781045392155647,
      "pose_mae_dy": 0.03820443153381348,
      "pose_rmse_dtheta": 0.19821801781654358,
      "pose_rmse_dx": 0.06982756406068802,
      "pose_rmse_dy": 0.09084869921207428,
      "pose_rmse_mean": 0.11963143199682236,
      "rmse_dtheta": 0.023809202015399933,
      "rmse_dx": 0.008499323390424252,
      "rmse_dy": 0.006301554385572672,
      "rmse_mean": 0.01287002768367529,
      "rotation_flip": 0.003973988350480795,
      "sparse_tokens": 32153.0,
      "step": 431,
      "turn_loss": 0.10600735247135162,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.020070618844081026,
      "grad_norm": 0.6249247789382935,
      "learning_rate": 9.983100150047315e-06,
      "loss": 0.1902,
      "mae_dtheta": 0.041815899312496185,
      "mae_dx": 0.006363387685269117,
      "mae_dy": 0.0036364782135933638,
      "pose_mae_dtheta": 0.39908820390701294,
      "pose_mae_dx": 0.056835971772670746,
      "pose_mae_dy": 0.0472000353038311,
      "pose_rmse_dtheta": 0.6120127439498901,
      "pose_rmse_dx": 0.13139323890209198,
      "pose_rmse_dy": 0.16289165616035461,
      "pose_rmse_mean": 0.30209922790527344,
      "rmse_dtheta": 0.056633539497852325,
      "rmse_dx": 0.015017419122159481,
      "rmse_dy": 0.008886219933629036,
      "rmse_mean": 0.026845727115869522,
      "rotation_flip": 0.005509641952812672,
      "sparse_tokens": 7548.0,
      "step": 432,
      "turn_loss": 0.2864016592502594,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.020117078609923806,
      "grad_norm": 0.5352773070335388,
      "learning_rate": 9.982991356370404e-06,
      "loss": 0.1283,
      "mae_dtheta": 0.03322750702500343,
      "mae_dx": 0.010914460755884647,
      "mae_dy": 0.004389392212033272,
      "pose_mae_dtheta": 0.26947271823883057,
      "pose_mae_dx": 0.08895029127597809,
      "pose_mae_dy": 0.07393070310354233,
      "pose_rmse_dtheta": 0.48269131779670715,
      "pose_rmse_dx": 0.2039618194103241,
      "pose_rmse_dy": 0.15311940014362335,
      "pose_rmse_mean": 0.2799241840839386,
      "rmse_dtheta": 0.05146085098385811,
      "rmse_dx": 0.024014094844460487,
      "rmse_dy": 0.007675929460674524,
      "rmse_mean": 0.02771696075797081,
      "rotation_flip": 0.00896286778151989,
      "sparse_tokens": 14442.0,
      "step": 433,
      "turn_loss": 0.2764318585395813,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.020163538375766586,
      "grad_norm": 0.6592016816139221,
      "learning_rate": 9.982882214230231e-06,
      "loss": 0.159,
      "mae_dtheta": 0.04362129420042038,
      "mae_dx": 0.0031005702912807465,
      "mae_dy": 0.002092592651024461,
      "pose_mae_dtheta": 0.37052178382873535,
      "pose_mae_dx": 0.021393384784460068,
      "pose_mae_dy": 0.028869131579995155,
      "pose_rmse_dtheta": 0.6699166893959045,
      "pose_rmse_dx": 0.05351665988564491,
      "pose_rmse_dy": 0.07531014829874039,
      "pose_rmse_mean": 0.26624786853790283,
      "rmse_dtheta": 0.0685269683599472,
      "rmse_dx": 0.00909297727048397,
      "rmse_dy": 0.004644467495381832,
      "rmse_mean": 0.02742147259414196,
      "rotation_flip": 0.016778523102402687,
      "sparse_tokens": 6684.0,
      "step": 434,
      "turn_loss": 0.17334961891174316,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.020209998141609366,
      "grad_norm": 0.5586084127426147,
      "learning_rate": 9.982772723634433e-06,
      "loss": 0.1642,
      "mae_dtheta": 0.014437568373978138,
      "mae_dx": 0.004898227751255035,
      "mae_dy": 0.003053037915378809,
      "pose_mae_dtheta": 0.1014319360256195,
      "pose_mae_dx": 0.048221223056316376,
      "pose_mae_dy": 0.04210951179265976,
      "pose_rmse_dtheta": 0.22463490068912506,
      "pose_rmse_dx": 0.1220552921295166,
      "pose_rmse_dy": 0.10235235840082169,
      "pose_rmse_mean": 0.14968085289001465,
      "rmse_dtheta": 0.02992822416126728,
      "rmse_dx": 0.013337737880647182,
      "rmse_dy": 0.007534160278737545,
      "rmse_mean": 0.016933374106884003,
      "rotation_flip": 0.005629478022456169,
      "sparse_tokens": 32073.0,
      "step": 435,
      "turn_loss": 0.16446749866008759,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.020256457907452147,
      "grad_norm": 1.1178715229034424,
      "learning_rate": 9.982662884590662e-06,
      "loss": 0.3125,
      "mae_dtheta": 0.04704415798187256,
      "mae_dx": 0.015244848094880581,
      "mae_dy": 0.0080499779433012,
      "pose_mae_dtheta": 0.4157889187335968,
      "pose_mae_dx": 0.11797156184911728,
      "pose_mae_dy": 0.10083474963903427,
      "pose_rmse_dtheta": 0.6786016225814819,
      "pose_rmse_dx": 0.24632935225963593,
      "pose_rmse_dy": 0.2262505143880844,
      "pose_rmse_mean": 0.38372716307640076,
      "rmse_dtheta": 0.06603597849607468,
      "rmse_dx": 0.02824322320520878,
      "rmse_dy": 0.016244063153862953,
      "rmse_mean": 0.03684108704328537,
      "rotation_flip": 0.014014014042913914,
      "sparse_tokens": 17182.0,
      "step": 436,
      "turn_loss": 0.38409292697906494,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.020302917673294927,
      "grad_norm": 0.5191962718963623,
      "learning_rate": 9.982552697106601e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.011907556094229221,
      "mae_dx": 0.0020946571603417397,
      "mae_dy": 0.0029386081732809544,
      "pose_mae_dtheta": 0.08648514747619629,
      "pose_mae_dx": 0.030812742188572884,
      "pose_mae_dy": 0.036389101296663284,
      "pose_rmse_dtheta": 0.18086138367652893,
      "pose_rmse_dx": 0.07662796974182129,
      "pose_rmse_dy": 0.09168083220720291,
      "pose_rmse_mean": 0.11639006435871124,
      "rmse_dtheta": 0.024240702390670776,
      "rmse_dx": 0.006058937404304743,
      "rmse_dy": 0.006322929635643959,
      "rmse_mean": 0.012207522988319397,
      "rotation_flip": 0.0049019609577953815,
      "sparse_tokens": 32073.0,
      "step": 437,
      "turn_loss": 0.09776841849088669,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.020349377439137707,
      "grad_norm": 0.5353862643241882,
      "learning_rate": 9.982442161189958e-06,
      "loss": 0.1512,
      "mae_dtheta": 0.014192147180438042,
      "mae_dx": 0.002881084568798542,
      "mae_dy": 0.002760541159659624,
      "pose_mae_dtheta": 0.0983838438987732,
      "pose_mae_dx": 0.031235523521900177,
      "pose_mae_dy": 0.029964271932840347,
      "pose_rmse_dtheta": 0.24599042534828186,
      "pose_rmse_dx": 0.0758378729224205,
      "pose_rmse_dy": 0.06779911369085312,
      "pose_rmse_mean": 0.1298758089542389,
      "rmse_dtheta": 0.03138826787471771,
      "rmse_dx": 0.008386380039155483,
      "rmse_dy": 0.00701426574960351,
      "rmse_mean": 0.015596305951476097,
      "rotation_flip": 0.0035252643283456564,
      "sparse_tokens": 32137.0,
      "step": 438,
      "turn_loss": 0.10060600191354752,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.020395837204980487,
      "grad_norm": 0.6703788042068481,
      "learning_rate": 9.982331276848457e-06,
      "loss": 0.1412,
      "mae_dtheta": 0.010972684249281883,
      "mae_dx": 0.002206983044743538,
      "mae_dy": 0.0021809814497828484,
      "pose_mae_dtheta": 0.08608673512935638,
      "pose_mae_dx": 0.02646261639893055,
      "pose_mae_dy": 0.03117646835744381,
      "pose_rmse_dtheta": 0.23793067038059235,
      "pose_rmse_dx": 0.0594792403280735,
      "pose_rmse_dy": 0.1050611212849617,
      "pose_rmse_mean": 0.13415701687335968,
      "rmse_dtheta": 0.025919582694768906,
      "rmse_dx": 0.005937057081609964,
      "rmse_dy": 0.005727813113480806,
      "rmse_mean": 0.012528151273727417,
      "rotation_flip": 0.008027522824704647,
      "sparse_tokens": 32169.0,
      "step": 439,
      "turn_loss": 0.09410455822944641,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.020442296970823268,
      "grad_norm": 0.6776579022407532,
      "learning_rate": 9.98222004408986e-06,
      "loss": 0.1908,
      "mae_dtheta": 0.036997538059949875,
      "mae_dx": 0.012836822308599949,
      "mae_dy": 0.005213366821408272,
      "pose_mae_dtheta": 0.33919277787208557,
      "pose_mae_dx": 0.09906753897666931,
      "pose_mae_dy": 0.04609899967908859,
      "pose_rmse_dtheta": 0.5389750003814697,
      "pose_rmse_dx": 0.22258833050727844,
      "pose_rmse_dy": 0.10670070350170135,
      "pose_rmse_mean": 0.28942134976387024,
      "rmse_dtheta": 0.05423545837402344,
      "rmse_dx": 0.02457355707883835,
      "rmse_dy": 0.011187811382114887,
      "rmse_mean": 0.029998943209648132,
      "rotation_flip": 0.007534984033554792,
      "sparse_tokens": 14907.0,
      "step": 440,
      "turn_loss": 0.32552558183670044,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.020488756736666048,
      "grad_norm": 1.0888665914535522,
      "learning_rate": 9.982108462921938e-06,
      "loss": 0.2676,
      "mae_dtheta": 0.03143493831157684,
      "mae_dx": 0.014359499327838421,
      "mae_dy": 0.0072267381474375725,
      "pose_mae_dtheta": 0.24206629395484924,
      "pose_mae_dx": 0.12939630448818207,
      "pose_mae_dy": 0.12100962549448013,
      "pose_rmse_dtheta": 0.38038212060928345,
      "pose_rmse_dx": 0.2616741359233856,
      "pose_rmse_dy": 0.2390783578157425,
      "pose_rmse_mean": 0.2937115430831909,
      "rmse_dtheta": 0.04492553696036339,
      "rmse_dx": 0.027748961001634598,
      "rmse_dy": 0.011754386126995087,
      "rmse_mean": 0.028142962604761124,
      "rotation_flip": 0.02358490601181984,
      "sparse_tokens": 14096.0,
      "step": 441,
      "turn_loss": 0.2626194655895233,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.020535216502508828,
      "grad_norm": 0.5846251249313354,
      "learning_rate": 9.981996533352497e-06,
      "loss": 0.089,
      "mae_dtheta": 0.009554712101817131,
      "mae_dx": 0.001305852783843875,
      "mae_dy": 0.00165486428886652,
      "pose_mae_dtheta": 0.06515004485845566,
      "pose_mae_dx": 0.019350603222846985,
      "pose_mae_dy": 0.028726745396852493,
      "pose_rmse_dtheta": 0.15328654646873474,
      "pose_rmse_dx": 0.04638352245092392,
      "pose_rmse_dy": 0.07441255450248718,
      "pose_rmse_mean": 0.09136088192462921,
      "rmse_dtheta": 0.02103021927177906,
      "rmse_dx": 0.004072488285601139,
      "rmse_dy": 0.003387461183592677,
      "rmse_mean": 0.009496723301708698,
      "rotation_flip": 0.002986348234117031,
      "sparse_tokens": 32089.0,
      "step": 442,
      "turn_loss": 0.06183526664972305,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.02058167626835161,
      "grad_norm": 0.4682058095932007,
      "learning_rate": 9.981884255389364e-06,
      "loss": 0.1363,
      "mae_dtheta": 0.040549978613853455,
      "mae_dx": 0.008699575439095497,
      "mae_dy": 0.004553059581667185,
      "pose_mae_dtheta": 0.36300918459892273,
      "pose_mae_dx": 0.0911702886223793,
      "pose_mae_dy": 0.04793313518166542,
      "pose_rmse_dtheta": 0.5974552035331726,
      "pose_rmse_dx": 0.187067911028862,
      "pose_rmse_dy": 0.1302788257598877,
      "pose_rmse_mean": 0.30493399500846863,
      "rmse_dtheta": 0.0582963190972805,
      "rmse_dx": 0.019590605050325394,
      "rmse_dy": 0.00869059469550848,
      "rmse_mean": 0.028859173879027367,
      "rotation_flip": 0.0031847134232521057,
      "sparse_tokens": 5058.0,
      "step": 443,
      "turn_loss": 0.20548173785209656,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.02062813603419439,
      "grad_norm": 0.5518503785133362,
      "learning_rate": 9.981771629040393e-06,
      "loss": 0.1121,
      "mae_dtheta": 0.03938055783510208,
      "mae_dx": 0.008242570795118809,
      "mae_dy": 0.0070470524951815605,
      "pose_mae_dtheta": 0.35543012619018555,
      "pose_mae_dx": 0.07130002975463867,
      "pose_mae_dy": 0.07230804860591888,
      "pose_rmse_dtheta": 0.6411317586898804,
      "pose_rmse_dx": 0.14892111718654633,
      "pose_rmse_dy": 0.18665874004364014,
      "pose_rmse_mean": 0.32557055354118347,
      "rmse_dtheta": 0.06041647121310234,
      "rmse_dx": 0.01648849993944168,
      "rmse_dy": 0.015601955354213715,
      "rmse_mean": 0.03083564154803753,
      "rotation_flip": 0.01116071455180645,
      "sparse_tokens": 7142.0,
      "step": 444,
      "turn_loss": 0.30463770031929016,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.02067459580003717,
      "grad_norm": 1.1452349424362183,
      "learning_rate": 9.981658654313458e-06,
      "loss": 0.2936,
      "mae_dtheta": 0.039032068103551865,
      "mae_dx": 0.004410404246300459,
      "mae_dy": 0.008740713819861412,
      "pose_mae_dtheta": 0.3618979752063751,
      "pose_mae_dx": 0.09458530694246292,
      "pose_mae_dy": 0.1227690726518631,
      "pose_rmse_dtheta": 0.6344011425971985,
      "pose_rmse_dx": 0.20521117746829987,
      "pose_rmse_dy": 0.23596757650375366,
      "pose_rmse_mean": 0.35852664709091187,
      "rmse_dtheta": 0.06008624657988548,
      "rmse_dx": 0.007372647523880005,
      "rmse_dy": 0.01449873112142086,
      "rmse_mean": 0.02731921151280403,
      "rotation_flip": 0.005291005130857229,
      "sparse_tokens": 3373.0,
      "step": 445,
      "turn_loss": 0.26876962184906006,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 18452.0,
      "epoch": 0.02072105556587995,
      "grad_norm": 0.6831555366516113,
      "learning_rate": 9.981545331216458e-06,
      "loss": 0.2055,
      "mae_dtheta": 0.0248715877532959,
      "mae_dx": 0.012816612608730793,
      "mae_dy": 0.0036567768547683954,
      "pose_mae_dtheta": 0.20485830307006836,
      "pose_mae_dx": 0.10260679572820663,
      "pose_mae_dy": 0.046635840088129044,
      "pose_rmse_dtheta": 0.3355466425418854,
      "pose_rmse_dx": 0.23588262498378754,
      "pose_rmse_dy": 0.10277528315782547,
      "pose_rmse_mean": 0.2247348427772522,
      "rmse_dtheta": 0.037768684327602386,
      "rmse_dx": 0.025481145828962326,
      "rmse_dy": 0.006603659130632877,
      "rmse_mean": 0.023284494876861572,
      "rotation_flip": 0.011782032437622547,
      "sparse_tokens": 14140.0,
      "step": 446,
      "turn_loss": 0.24564053118228912,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.02076751533172273,
      "grad_norm": 0.8742116093635559,
      "learning_rate": 9.98143165975732e-06,
      "loss": 0.1654,
      "mae_dtheta": 0.02050936408340931,
      "mae_dx": 0.004765826743096113,
      "mae_dy": 0.007716773543506861,
      "pose_mae_dtheta": 0.15272629261016846,
      "pose_mae_dx": 0.06728389859199524,
      "pose_mae_dy": 0.07682005316019058,
      "pose_rmse_dtheta": 0.31220731139183044,
      "pose_rmse_dx": 0.15107733011245728,
      "pose_rmse_dy": 0.2130982130765915,
      "pose_rmse_mean": 0.225460946559906,
      "rmse_dtheta": 0.03637709096074104,
      "rmse_dx": 0.010920650325715542,
      "rmse_dy": 0.016484897583723068,
      "rmse_mean": 0.021260879933834076,
      "rotation_flip": 0.006901084445416927,
      "sparse_tokens": 32105.0,
      "step": 447,
      "turn_loss": 0.22150956094264984,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.02081397509756551,
      "grad_norm": 0.7066833972930908,
      "learning_rate": 9.981317639943993e-06,
      "loss": 0.1812,
      "mae_dtheta": 0.03107382357120514,
      "mae_dx": 0.008834966458380222,
      "mae_dy": 0.003117392770946026,
      "pose_mae_dtheta": 0.23234841227531433,
      "pose_mae_dx": 0.07865466922521591,
      "pose_mae_dy": 0.034529104828834534,
      "pose_rmse_dtheta": 0.46538329124450684,
      "pose_rmse_dx": 0.17882785201072693,
      "pose_rmse_dy": 0.0908568799495697,
      "pose_rmse_mean": 0.2450226992368698,
      "rmse_dtheta": 0.05161137506365776,
      "rmse_dx": 0.019580844789743423,
      "rmse_dy": 0.006659971084445715,
      "rmse_mean": 0.025950729846954346,
      "rotation_flip": 0.008205127902328968,
      "sparse_tokens": 18080.0,
      "step": 448,
      "turn_loss": 0.2382737100124359,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.02086043486340829,
      "grad_norm": 0.4889216721057892,
      "learning_rate": 9.98120327178445e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.011483059264719486,
      "mae_dx": 0.0029621764551848173,
      "mae_dy": 0.0019144332036376,
      "pose_mae_dtheta": 0.0879470705986023,
      "pose_mae_dx": 0.027532894164323807,
      "pose_mae_dy": 0.0179824847728014,
      "pose_rmse_dtheta": 0.2547370493412018,
      "pose_rmse_dx": 0.07083429396152496,
      "pose_rmse_dy": 0.05703410133719444,
      "pose_rmse_mean": 0.1275351643562317,
      "rmse_dtheta": 0.028985975310206413,
      "rmse_dx": 0.00831675436347723,
      "rmse_dy": 0.006103713996708393,
      "rmse_mean": 0.014468814246356487,
      "rotation_flip": 0.003982300870120525,
      "sparse_tokens": 32201.0,
      "step": 449,
      "turn_loss": 0.10470636934041977,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.02090689462925107,
      "grad_norm": 0.5734881162643433,
      "learning_rate": 9.981088555286686e-06,
      "loss": 0.149,
      "mae_dtheta": 0.011238675564527512,
      "mae_dx": 0.002365262247622013,
      "mae_dy": 0.002777013462036848,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5734881162643433,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 149.59585571289062,
      "model/head/act_norm_mean": 106.27971117424242,
      "model/head/act_norm_min": 66.54183959960938,
      "model/head/act_over_embed": 73.03641252527198,
      "model/head/grad_frac": 0.10266008228063583,
      "model/head/grad_norm": 0.05887433886528015,
      "model/head/grad_zero_frac": 0.00013801321620121598,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6835740214646465,
      "model/head/update_ratio": 0.0010302411392331123,
      "model/head/weight_delta": 2.420682907104492,
      "model/head/weight_delta_rel": 0.042465947568416595,
      "model/head/weight_norm": 57.146175384521484,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.40981176495552063,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4097437448631045,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4096674621105194,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2815797375513033,
      "model/modality_embedder.encoders.pose/grad_frac": 0.061033543199300766,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03500201180577278,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.4939550339366516,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011423291871324182,
      "model/modality_embedder.encoders.pose/weight_delta": 0.7011837363243103,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.02290985733270645,
      "model/modality_embedder.encoders.pose/weight_norm": 30.640914916992188,
      "model/modality_embedder/grad_frac": 0.061033543199300766,
      "model/modality_embedder/grad_norm": 0.03500201180577278,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.4939550339366516,
      "model/modality_embedder/update_ratio": 0.0011423291871324182,
      "model/modality_embedder/weight_delta": 0.7011837363243103,
      "model/modality_embedder/weight_delta_rel": 0.02290985733270645,
      "model/modality_embedder/weight_norm": 30.640914916992188,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.06535339355469,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.850386303511304,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.841031074523926,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.702999396460044,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10639601945877075,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06101685389876366,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002220847876742482,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.31860610842704773,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.011610198765993118,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.474576950073242,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.4255599975586,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.92748917748918,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.477351188659668,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.44319457545362,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09332282096147537,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05351952835917473,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001849971478804946,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.36174440383911133,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.012531109154224396,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.929920196533203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.13280487060547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.849937870771203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.552873611450195,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.764319315725263,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09392012655735016,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0538620762526989,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018045319011434913,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.3636898696422577,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.012212025001645088,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.84822654724121,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.93233489990234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.718755010421678,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.53615951538086,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.048587950234786,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08750629425048828,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.050183817744255066,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017121926648542285,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.30147886276245117,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.010303116403520107,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.30967903137207,
      "model/normalizer/grad_frac": 0.3717626929283142,
      "model/normalizer/grad_norm": 0.21320147812366486,
      "model/normalizer/grad_zero_frac": 0.00013235470396466553,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0027434686198830605,
      "model/normalizer/weight_delta": 0.6953878998756409,
      "model/normalizer/weight_delta_rel": 0.008956193923950195,
      "model/normalizer/weight_norm": 77.7123794555664,
      "pose_mae_dtheta": 0.08144452422857285,
      "pose_mae_dx": 0.029738927260041237,
      "pose_mae_dy": 0.032660603523254395,
      "pose_rmse_dtheta": 0.18508388102054596,
      "pose_rmse_dx": 0.08082913607358932,
      "pose_rmse_dy": 0.08569935709238052,
      "pose_rmse_mean": 0.11720412224531174,
      "rmse_dtheta": 0.02164340205490589,
      "rmse_dx": 0.00702610844746232,
      "rmse_dy": 0.006649140268564224,
      "rmse_mean": 0.0117728840559721,
      "rotation_flip": 0.0040633887983858585,
      "sparse_tokens": 32089.0,
      "step": 450,
      "turn_loss": 0.08456018567085266,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.02095335439509385,
      "grad_norm": 0.5166268348693848,
      "learning_rate": 9.980973490458728e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.013661283999681473,
      "mae_dx": 0.002639803336933255,
      "mae_dy": 0.004077550955116749,
      "pose_mae_dtheta": 0.09236304461956024,
      "pose_mae_dx": 0.03880401700735092,
      "pose_mae_dy": 0.043879538774490356,
      "pose_rmse_dtheta": 0.18763472139835358,
      "pose_rmse_dx": 0.09286976605653763,
      "pose_rmse_dy": 0.09815894812345505,
      "pose_rmse_mean": 0.12622115015983582,
      "rmse_dtheta": 0.024984966963529587,
      "rmse_dx": 0.007475297898054123,
      "rmse_dy": 0.008163679391145706,
      "rmse_mean": 0.013541314750909805,
      "rotation_flip": 0.008452774956822395,
      "sparse_tokens": 32057.0,
      "step": 451,
      "turn_loss": 0.11380354315042496,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.020999814160936627,
      "grad_norm": 0.6301258206367493,
      "learning_rate": 9.98085807730862e-06,
      "loss": 0.1381,
      "mae_dtheta": 0.008831577375531197,
      "mae_dx": 0.0020562810823321342,
      "mae_dy": 0.0022201186511665583,
      "pose_mae_dtheta": 0.06371215730905533,
      "pose_mae_dx": 0.027680322527885437,
      "pose_mae_dy": 0.03158159554004669,
      "pose_rmse_dtheta": 0.12749961018562317,
      "pose_rmse_dx": 0.06816084682941437,
      "pose_rmse_dy": 0.07822106033563614,
      "pose_rmse_mean": 0.09129384160041809,
      "rmse_dtheta": 0.017762087285518646,
      "rmse_dx": 0.005954233463853598,
      "rmse_dy": 0.004918751772493124,
      "rmse_mean": 0.00954502448439598,
      "rotation_flip": 0.003927729558199644,
      "sparse_tokens": 32121.0,
      "step": 452,
      "turn_loss": 0.07026313245296478,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.021046273926779407,
      "grad_norm": 0.5747513175010681,
      "learning_rate": 9.980742315844435e-06,
      "loss": 0.2081,
      "mae_dtheta": 0.014082229696214199,
      "mae_dx": 0.003460102481767535,
      "mae_dy": 0.0036424335557967424,
      "pose_mae_dtheta": 0.09660078585147858,
      "pose_mae_dx": 0.043653249740600586,
      "pose_mae_dy": 0.04697398468852043,
      "pose_rmse_dtheta": 0.18795549869537354,
      "pose_rmse_dx": 0.1073094829916954,
      "pose_rmse_dy": 0.10070930421352386,
      "pose_rmse_mean": 0.1319914311170578,
      "rmse_dtheta": 0.027052484452724457,
      "rmse_dx": 0.009715487249195576,
      "rmse_dy": 0.0076975226402282715,
      "rmse_mean": 0.01482183113694191,
      "rotation_flip": 0.005747126415371895,
      "sparse_tokens": 32089.0,
      "step": 453,
      "turn_loss": 0.15602882206439972,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.021092733692622188,
      "grad_norm": 0.43414628505706787,
      "learning_rate": 9.980626206074263e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.039959512650966644,
      "mae_dx": 0.015227663330733776,
      "mae_dy": 0.004132222384214401,
      "pose_mae_dtheta": 0.341154545545578,
      "pose_mae_dx": 0.11507265269756317,
      "pose_mae_dy": 0.04640205577015877,
      "pose_rmse_dtheta": 0.5696434378623962,
      "pose_rmse_dx": 0.24143701791763306,
      "pose_rmse_dy": 0.11962949484586716,
      "pose_rmse_mean": 0.3102366626262665,
      "rmse_dtheta": 0.05827195197343826,
      "rmse_dx": 0.0275498628616333,
      "rmse_dy": 0.008041194640100002,
      "rmse_mean": 0.03128767013549805,
      "rotation_flip": 0.003636363660916686,
      "sparse_tokens": 11294.0,
      "step": 454,
      "turn_loss": 0.28523534536361694,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.021139193458464968,
      "grad_norm": 0.5074315667152405,
      "learning_rate": 9.980509748006229e-06,
      "loss": 0.1606,
      "mae_dtheta": 0.010352103039622307,
      "mae_dx": 0.0020726649090647697,
      "mae_dy": 0.002488986821845174,
      "pose_mae_dtheta": 0.07422268390655518,
      "pose_mae_dx": 0.02783988043665886,
      "pose_mae_dy": 0.03179251775145531,
      "pose_rmse_dtheta": 0.1771015226840973,
      "pose_rmse_dx": 0.08110284805297852,
      "pose_rmse_dy": 0.07365009188652039,
      "pose_rmse_mean": 0.11061815917491913,
      "rmse_dtheta": 0.022803984582424164,
      "rmse_dx": 0.006563224829733372,
      "rmse_dy": 0.00625917874276638,
      "rmse_mean": 0.011875463649630547,
      "rotation_flip": 0.003569834865629673,
      "sparse_tokens": 32073.0,
      "step": 455,
      "turn_loss": 0.08825677633285522,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.021185653224307748,
      "grad_norm": 0.5403255224227905,
      "learning_rate": 9.980392941648476e-06,
      "loss": 0.1799,
      "mae_dtheta": 0.015233553946018219,
      "mae_dx": 0.004436185583472252,
      "mae_dy": 0.00421897042542696,
      "pose_mae_dtheta": 0.11436942964792252,
      "pose_mae_dx": 0.050742991268634796,
      "pose_mae_dy": 0.04026321321725845,
      "pose_rmse_dtheta": 0.2679193317890167,
      "pose_rmse_dx": 0.14977507293224335,
      "pose_rmse_dy": 0.09321357309818268,
      "pose_rmse_mean": 0.17030265927314758,
      "rmse_dtheta": 0.031745970249176025,
      "rmse_dx": 0.011821693740785122,
      "rmse_dy": 0.01007470116019249,
      "rmse_mean": 0.017880789935588837,
      "rotation_flip": 0.0058165546506643295,
      "sparse_tokens": 32089.0,
      "step": 456,
      "turn_loss": 0.14132378995418549,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.02123211299015053,
      "grad_norm": 0.5316402316093445,
      "learning_rate": 9.98027578700917e-06,
      "loss": 0.1858,
      "mae_dtheta": 0.029872989282011986,
      "mae_dx": 0.010382875800132751,
      "mae_dy": 0.005620187148451805,
      "pose_mae_dtheta": 0.24058794975280762,
      "pose_mae_dx": 0.09268950670957565,
      "pose_mae_dy": 0.04783592373132706,
      "pose_rmse_dtheta": 0.40813973546028137,
      "pose_rmse_dx": 0.2159469723701477,
      "pose_rmse_dy": 0.10054797679185867,
      "pose_rmse_mean": 0.2415449023246765,
      "rmse_dtheta": 0.04586935415863991,
      "rmse_dx": 0.021279534325003624,
      "rmse_dy": 0.010746459476649761,
      "rmse_mean": 0.025965115055441856,
      "rotation_flip": 0.017937220633029938,
      "sparse_tokens": 7862.0,
      "step": 457,
      "turn_loss": 0.27871817350387573,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.02127857275599331,
      "grad_norm": 0.44552159309387207,
      "learning_rate": 9.980158284096505e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.011992452666163445,
      "mae_dx": 0.00253021321259439,
      "mae_dy": 0.0026219235733151436,
      "pose_mae_dtheta": 0.08236099034547806,
      "pose_mae_dx": 0.03135644271969795,
      "pose_mae_dy": 0.03704428672790527,
      "pose_rmse_dtheta": 0.17159707844257355,
      "pose_rmse_dx": 0.08249447494745255,
      "pose_rmse_dy": 0.08184069395065308,
      "pose_rmse_mean": 0.11197742074728012,
      "rmse_dtheta": 0.02380749024450779,
      "rmse_dx": 0.008349415846168995,
      "rmse_dy": 0.005454284604638815,
      "rmse_mean": 0.012537064030766487,
      "rotation_flip": 0.011456628330051899,
      "sparse_tokens": 32073.0,
      "step": 458,
      "turn_loss": 0.10873609781265259,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.02132503252183609,
      "grad_norm": 0.55515056848526,
      "learning_rate": 9.980040432918699e-06,
      "loss": 0.1645,
      "mae_dtheta": 0.033172208815813065,
      "mae_dx": 0.011691175401210785,
      "mae_dy": 0.004307636525481939,
      "pose_mae_dtheta": 0.23133307695388794,
      "pose_mae_dx": 0.08852741122245789,
      "pose_mae_dy": 0.05158344656229019,
      "pose_rmse_dtheta": 0.4369696080684662,
      "pose_rmse_dx": 0.20750705897808075,
      "pose_rmse_dy": 0.12072883546352386,
      "pose_rmse_mean": 0.25506851077079773,
      "rmse_dtheta": 0.051591355353593826,
      "rmse_dx": 0.023562857881188393,
      "rmse_dy": 0.009463452734053135,
      "rmse_mean": 0.028205890208482742,
      "rotation_flip": 0.01742919348180294,
      "sparse_tokens": 16059.0,
      "step": 459,
      "turn_loss": 0.2409425973892212,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.02137149228767887,
      "grad_norm": 0.4182836413383484,
      "learning_rate": 9.979922233483993e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.006370315328240395,
      "mae_dx": 0.001615138491615653,
      "mae_dy": 0.0009994041174650192,
      "pose_mae_dtheta": 0.04243500903248787,
      "pose_mae_dx": 0.015766700729727745,
      "pose_mae_dy": 0.01505152229219675,
      "pose_rmse_dtheta": 0.11759696155786514,
      "pose_rmse_dx": 0.04322844743728638,
      "pose_rmse_dy": 0.04168861731886864,
      "pose_rmse_mean": 0.06750467419624329,
      "rmse_dtheta": 0.018389875069260597,
      "rmse_dx": 0.005281923804432154,
      "rmse_dy": 0.0024031170178204775,
      "rmse_mean": 0.008691638708114624,
      "rotation_flip": 0.0026041667442768812,
      "sparse_tokens": 32089.0,
      "step": 460,
      "turn_loss": 0.049951910972595215,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.02141795205352165,
      "grad_norm": 0.8444680571556091,
      "learning_rate": 9.979803685800651e-06,
      "loss": 0.1841,
      "mae_dtheta": 0.0324503593146801,
      "mae_dx": 0.013536807149648666,
      "mae_dy": 0.0033780152443796396,
      "pose_mae_dtheta": 0.2509554326534271,
      "pose_mae_dx": 0.10398001968860626,
      "pose_mae_dy": 0.02794933132827282,
      "pose_rmse_dtheta": 0.4368537366390228,
      "pose_rmse_dx": 0.23143865168094635,
      "pose_rmse_dy": 0.05611846596002579,
      "pose_rmse_mean": 0.2414703071117401,
      "rmse_dtheta": 0.051153577864170074,
      "rmse_dx": 0.026932917535305023,
      "rmse_dy": 0.0065898895263671875,
      "rmse_mean": 0.02822546288371086,
      "rotation_flip": 0.003246753243729472,
      "sparse_tokens": 5564.0,
      "step": 461,
      "turn_loss": 0.21004636585712433,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.02146441181936443,
      "grad_norm": 0.45612776279449463,
      "learning_rate": 9.979684789876965e-06,
      "loss": 0.103,
      "mae_dtheta": 0.015400080010294914,
      "mae_dx": 0.0017520232358947396,
      "mae_dy": 0.003110770834609866,
      "pose_mae_dtheta": 0.10950420796871185,
      "pose_mae_dx": 0.03355914354324341,
      "pose_mae_dy": 0.04361606761813164,
      "pose_rmse_dtheta": 0.2489931434392929,
      "pose_rmse_dx": 0.07988147437572479,
      "pose_rmse_dy": 0.10365062952041626,
      "pose_rmse_mean": 0.14417508244514465,
      "rmse_dtheta": 0.029747966676950455,
      "rmse_dx": 0.004244344308972359,
      "rmse_dy": 0.006418546196073294,
      "rmse_mean": 0.013470286503434181,
      "rotation_flip": 0.006353688891977072,
      "sparse_tokens": 32089.0,
      "step": 462,
      "turn_loss": 0.10566699504852295,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.02151087158520721,
      "grad_norm": 0.45289355516433716,
      "learning_rate": 9.979565545721249e-06,
      "loss": 0.0949,
      "mae_dtheta": 0.012683745473623276,
      "mae_dx": 0.001978093758225441,
      "mae_dy": 0.002230327110737562,
      "pose_mae_dtheta": 0.09419366717338562,
      "pose_mae_dx": 0.026765557006001472,
      "pose_mae_dy": 0.03252170607447624,
      "pose_rmse_dtheta": 0.235556960105896,
      "pose_rmse_dx": 0.06141621246933937,
      "pose_rmse_dy": 0.07167580723762512,
      "pose_rmse_mean": 0.12288299202919006,
      "rmse_dtheta": 0.02729896828532219,
      "rmse_dx": 0.005724107380956411,
      "rmse_dy": 0.00454251142218709,
      "rmse_mean": 0.012521862052381039,
      "rotation_flip": 0.0045334342867136,
      "sparse_tokens": 32105.0,
      "step": 463,
      "turn_loss": 0.09523619711399078,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.02155733135104999,
      "grad_norm": 0.547280490398407,
      "learning_rate": 9.979445953341841e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.011992447078227997,
      "mae_dx": 0.002360262908041477,
      "mae_dy": 0.002542933216318488,
      "pose_mae_dtheta": 0.08941700309515,
      "pose_mae_dx": 0.027925319969654083,
      "pose_mae_dy": 0.034101758152246475,
      "pose_rmse_dtheta": 0.21211600303649902,
      "pose_rmse_dx": 0.07364678382873535,
      "pose_rmse_dy": 0.08520839363336563,
      "pose_rmse_mean": 0.12365706264972687,
      "rmse_dtheta": 0.025785382837057114,
      "rmse_dx": 0.006483850069344044,
      "rmse_dy": 0.0069053880870342255,
      "rmse_mean": 0.013058206997811794,
      "rotation_flip": 0.005092761013656855,
      "sparse_tokens": 32121.0,
      "step": 464,
      "turn_loss": 0.09098243713378906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.02160379111689277,
      "grad_norm": 0.4969450533390045,
      "learning_rate": 9.979326012747106e-06,
      "loss": 0.1308,
      "mae_dtheta": 0.04041454568505287,
      "mae_dx": 0.014235599897801876,
      "mae_dy": 0.004064594395458698,
      "pose_mae_dtheta": 0.34881770610809326,
      "pose_mae_dx": 0.10959877818822861,
      "pose_mae_dy": 0.0647883266210556,
      "pose_rmse_dtheta": 0.6177945137023926,
      "pose_rmse_dx": 0.23522859811782837,
      "pose_rmse_dy": 0.16216281056404114,
      "pose_rmse_mean": 0.3383953273296356,
      "rmse_dtheta": 0.060779985040426254,
      "rmse_dx": 0.027153255417943,
      "rmse_dy": 0.0077138333581388,
      "rmse_mean": 0.03188236057758331,
      "rotation_flip": 0.00906344410032034,
      "sparse_tokens": 13058.0,
      "step": 465,
      "turn_loss": 0.2604331076145172,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.02165025088273555,
      "grad_norm": 0.8417678475379944,
      "learning_rate": 9.97920572394543e-06,
      "loss": 0.1658,
      "mae_dtheta": 0.04386826604604721,
      "mae_dx": 0.015742002055048943,
      "mae_dy": 0.004846095107495785,
      "pose_mae_dtheta": 0.38783061504364014,
      "pose_mae_dx": 0.12391216307878494,
      "pose_mae_dy": 0.05541020259261131,
      "pose_rmse_dtheta": 0.6418633460998535,
      "pose_rmse_dx": 0.26083508133888245,
      "pose_rmse_dy": 0.11013078689575195,
      "pose_rmse_mean": 0.33760973811149597,
      "rmse_dtheta": 0.06122259423136711,
      "rmse_dx": 0.029247546568512917,
      "rmse_dy": 0.008224261924624443,
      "rmse_mean": 0.03289813548326492,
      "rotation_flip": 0.006521739065647125,
      "sparse_tokens": 7850.0,
      "step": 466,
      "turn_loss": 0.27178966999053955,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.02169671064857833,
      "grad_norm": 0.534013032913208,
      "learning_rate": 9.979085086945225e-06,
      "loss": 0.1555,
      "mae_dtheta": 0.010418375954031944,
      "mae_dx": 0.0019109060522168875,
      "mae_dy": 0.0022853310219943523,
      "pose_mae_dtheta": 0.06952385604381561,
      "pose_mae_dx": 0.023420602083206177,
      "pose_mae_dy": 0.029344206675887108,
      "pose_rmse_dtheta": 0.15710723400115967,
      "pose_rmse_dx": 0.05957170948386192,
      "pose_rmse_dy": 0.07113238424062729,
      "pose_rmse_mean": 0.09593711793422699,
      "rmse_dtheta": 0.021012621000409126,
      "rmse_dx": 0.0057609789073467255,
      "rmse_dy": 0.005131624639034271,
      "rmse_mean": 0.010635076090693474,
      "rotation_flip": 0.003979307599365711,
      "sparse_tokens": 32089.0,
      "step": 467,
      "turn_loss": 0.07650871574878693,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.02174317041442111,
      "grad_norm": 0.5705031156539917,
      "learning_rate": 9.978964101754927e-06,
      "loss": 0.1421,
      "mae_dtheta": 0.008999450132250786,
      "mae_dx": 0.0018078031716868281,
      "mae_dy": 0.0015395624795928597,
      "pose_mae_dtheta": 0.0632416307926178,
      "pose_mae_dx": 0.019543536007404327,
      "pose_mae_dy": 0.02169046550989151,
      "pose_rmse_dtheta": 0.16774477064609528,
      "pose_rmse_dx": 0.050367988646030426,
      "pose_rmse_dy": 0.051342256367206573,
      "pose_rmse_mean": 0.08981834352016449,
      "rmse_dtheta": 0.02152257040143013,
      "rmse_dx": 0.005615114234387875,
      "rmse_dy": 0.003491072915494442,
      "rmse_mean": 0.010209586471319199,
      "rotation_flip": 0.0027868091128766537,
      "sparse_tokens": 32105.0,
      "step": 468,
      "turn_loss": 0.07859814912080765,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23618.0,
      "epoch": 0.02178963018026389,
      "grad_norm": 0.6199859976768494,
      "learning_rate": 9.978842768382999e-06,
      "loss": 0.1991,
      "mae_dtheta": 0.040374867618083954,
      "mae_dx": 0.017123039811849594,
      "mae_dy": 0.005895392969250679,
      "pose_mae_dtheta": 0.3347180187702179,
      "pose_mae_dx": 0.14204563200473785,
      "pose_mae_dy": 0.08593517541885376,
      "pose_rmse_dtheta": 0.579247236251831,
      "pose_rmse_dx": 0.28413376212120056,
      "pose_rmse_dy": 0.19024032354354858,
      "pose_rmse_mean": 0.35120710730552673,
      "rmse_dtheta": 0.05972156301140785,
      "rmse_dx": 0.029947392642498016,
      "rmse_dy": 0.012979875318706036,
      "rmse_mean": 0.03421627730131149,
      "rotation_flip": 0.01305220928043127,
      "sparse_tokens": 18258.0,
      "step": 469,
      "turn_loss": 0.328230082988739,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 29432.0,
      "epoch": 0.02183608994610667,
      "grad_norm": 0.5370784401893616,
      "learning_rate": 9.978721086837922e-06,
      "loss": 0.1901,
      "mae_dtheta": 0.03566828370094299,
      "mae_dx": 0.013108043931424618,
      "mae_dy": 0.006532163359224796,
      "pose_mae_dtheta": 0.2584943175315857,
      "pose_mae_dx": 0.10486199706792831,
      "pose_mae_dy": 0.07577332854270935,
      "pose_rmse_dtheta": 0.44863253831863403,
      "pose_rmse_dx": 0.22539104521274567,
      "pose_rmse_dy": 0.1520252227783203,
      "pose_rmse_mean": 0.27534961700439453,
      "rmse_dtheta": 0.05236881598830223,
      "rmse_dx": 0.025456268340349197,
      "rmse_dy": 0.01143600046634674,
      "rmse_mean": 0.02975369617342949,
      "rotation_flip": 0.01701183430850506,
      "sparse_tokens": 21816.0,
      "step": 470,
      "turn_loss": 0.34805911779403687,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.021882549711949452,
      "grad_norm": 0.4758904278278351,
      "learning_rate": 9.978599057128207e-06,
      "loss": 0.0984,
      "mae_dtheta": 0.030058402568101883,
      "mae_dx": 0.012870529666543007,
      "mae_dy": 0.005362811032682657,
      "pose_mae_dtheta": 0.2226453274488449,
      "pose_mae_dx": 0.1171393170952797,
      "pose_mae_dy": 0.061675798147916794,
      "pose_rmse_dtheta": 0.4248597323894501,
      "pose_rmse_dx": 0.21866750717163086,
      "pose_rmse_dy": 0.15439514815807343,
      "pose_rmse_mean": 0.26597416400909424,
      "rmse_dtheta": 0.04992510378360748,
      "rmse_dx": 0.023954011499881744,
      "rmse_dy": 0.010308552533388138,
      "rmse_mean": 0.02806255780160427,
      "rotation_flip": 0.01600000075995922,
      "sparse_tokens": 4547.0,
      "step": 471,
      "turn_loss": 0.2344081997871399,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 62912.0,
      "epoch": 0.021929009477792232,
      "grad_norm": 0.6276295185089111,
      "learning_rate": 9.978476679262387e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.011872421018779278,
      "mae_dx": 0.0024153946433216333,
      "mae_dy": 0.0026547412853688,
      "pose_mae_dtheta": 0.07803108543157578,
      "pose_mae_dx": 0.02447720244526863,
      "pose_mae_dy": 0.03343840688467026,
      "pose_rmse_dtheta": 0.17762553691864014,
      "pose_rmse_dx": 0.058738332241773605,
      "pose_rmse_dy": 0.0947609543800354,
      "pose_rmse_mean": 0.11037494987249374,
      "rmse_dtheta": 0.02471344731748104,
      "rmse_dx": 0.00700340373441577,
      "rmse_dy": 0.006944506429135799,
      "rmse_mean": 0.012887119315564632,
      "rotation_flip": 0.008287292905151844,
      "sparse_tokens": 32012.0,
      "step": 472,
      "turn_loss": 0.09589206427335739,
      "turns": 193.0,
      "turns_per_sample": 193.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.021975469243635012,
      "grad_norm": 0.9603106379508972,
      "learning_rate": 9.978353953249023e-06,
      "loss": 0.3377,
      "mae_dtheta": 0.03851231187582016,
      "mae_dx": 0.01703762263059616,
      "mae_dy": 0.006833292543888092,
      "pose_mae_dtheta": 0.31908124685287476,
      "pose_mae_dx": 0.14050517976284027,
      "pose_mae_dy": 0.08484112471342087,
      "pose_rmse_dtheta": 0.49922415614128113,
      "pose_rmse_dx": 0.27453526854515076,
      "pose_rmse_dy": 0.16358497738838196,
      "pose_rmse_mean": 0.3124481439590454,
      "rmse_dtheta": 0.05417410284280777,
      "rmse_dx": 0.030251938849687576,
      "rmse_dy": 0.010151977650821209,
      "rmse_mean": 0.03152600675821304,
      "rotation_flip": 0.0,
      "sparse_tokens": 7000.0,
      "step": 473,
      "turn_loss": 0.27826568484306335,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.022021929009477793,
      "grad_norm": 0.5623176693916321,
      "learning_rate": 9.978230879096693e-06,
      "loss": 0.0926,
      "mae_dtheta": 0.012483608908951283,
      "mae_dx": 0.0026992675848305225,
      "mae_dy": 0.0032795502338558435,
      "pose_mae_dtheta": 0.09497633576393127,
      "pose_mae_dx": 0.03313577547669411,
      "pose_mae_dy": 0.037186894565820694,
      "pose_rmse_dtheta": 0.24577094614505768,
      "pose_rmse_dx": 0.08755555748939514,
      "pose_rmse_dy": 0.09315376728773117,
      "pose_rmse_mean": 0.142160102725029,
      "rmse_dtheta": 0.02797655016183853,
      "rmse_dx": 0.007477132137864828,
      "rmse_dy": 0.007883246056735516,
      "rmse_mean": 0.014445642940700054,
      "rotation_flip": 0.004919499158859253,
      "sparse_tokens": 32105.0,
      "step": 474,
      "turn_loss": 0.11137126386165619,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.022068388775320573,
      "grad_norm": 0.6652677655220032,
      "learning_rate": 9.978107456814007e-06,
      "loss": 0.1472,
      "mae_dtheta": 0.03768743574619293,
      "mae_dx": 0.010891173034906387,
      "mae_dy": 0.005446041468530893,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.665267825126648,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 119.56316375732422,
      "model/head/act_norm_mean": 90.2629657451923,
      "model/head/act_norm_min": 59.44997787475586,
      "model/head/act_over_embed": 62.02955511529552,
      "model/head/grad_frac": 0.09902624040842056,
      "model/head/grad_norm": 0.0658789724111557,
      "model/head/grad_zero_frac": 0.0001776721910573542,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.687109375,
      "model/head/update_ratio": 0.0011526556918397546,
      "model/head/weight_delta": 2.4786157608032227,
      "model/head/weight_delta_rel": 0.04348226264119148,
      "model/head/weight_norm": 57.15407943725586,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4098363518714905,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4098363518714905,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4098363518714905,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2816433779544666,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07797998934984207,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05187757685780525,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016929866978898644,
      "model/modality_embedder.encoders.pose/weight_delta": 0.7178425192832947,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.023454152047634125,
      "model/modality_embedder.encoders.pose/weight_norm": 30.642637252807617,
      "model/modality_embedder/grad_frac": 0.07797998934984207,
      "model/modality_embedder/grad_norm": 0.05187757685780525,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0016929866978898644,
      "model/modality_embedder/weight_delta": 0.7178425192832947,
      "model/modality_embedder/weight_delta_rel": 0.023454152047634125,
      "model/modality_embedder/weight_norm": 30.642637252807617,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 67.05552673339844,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.35515873015873,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.116386413574219,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.675465009511063,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06806629151105881,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04528231546282768,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001648005680181086,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.3285514712333679,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.011972613632678986,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.477039337158203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 68.7569808959961,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.275106837606838,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.60824203491211,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.30766196163928,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06636583805084229,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04415105655789375,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015259213978424668,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.37585797905921936,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.013020014390349388,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.934030532836914,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 70.78532409667969,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.01691659035409,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.068140029907227,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.504649930807016,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06557659804821014,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04362599924206734,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014613851672038436,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.37955325841903687,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.012744687497615814,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.85249900817871,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 71.76547241210938,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.081654456654455,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.064316749572754,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 17.923557122909088,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07410554587841034,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04930003359913826,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001681849011220038,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.31618133187294006,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.010805577039718628,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.31299591064453,
      "model/normalizer/grad_frac": 0.21293741464614868,
      "model/normalizer/grad_norm": 0.1416604071855545,
      "model/normalizer/grad_zero_frac": 0.00023043899273034185,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018227759283035994,
      "model/normalizer/weight_delta": 0.7230788469314575,
      "model/normalizer/weight_delta_rel": 0.009312836453318596,
      "model/normalizer/weight_norm": 77.71685028076172,
      "pose_mae_dtheta": 0.30645546317100525,
      "pose_mae_dx": 0.09034909307956696,
      "pose_mae_dy": 0.07743538916110992,
      "pose_rmse_dtheta": 0.5177035331726074,
      "pose_rmse_dx": 0.19626553356647491,
      "pose_rmse_dy": 0.1560857743024826,
      "pose_rmse_mean": 0.2900182902812958,
      "rmse_dtheta": 0.05491058528423309,
      "rmse_dx": 0.02320900931954384,
      "rmse_dy": 0.009438931941986084,
      "rmse_mean": 0.029186174273490906,
      "rotation_flip": 0.006889763753861189,
      "sparse_tokens": 17137.0,
      "step": 475,
      "turn_loss": 0.2595052719116211,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.022114848541163353,
      "grad_norm": 0.747978687286377,
      "learning_rate": 9.977983686409595e-06,
      "loss": 0.1622,
      "mae_dtheta": 0.03730377182364464,
      "mae_dx": 0.006894025951623917,
      "mae_dy": 0.003786503104493022,
      "pose_mae_dtheta": 0.31204041838645935,
      "pose_mae_dx": 0.0489027202129364,
      "pose_mae_dy": 0.03949688374996185,
      "pose_rmse_dtheta": 0.5312557816505432,
      "pose_rmse_dx": 0.10993169248104095,
      "pose_rmse_dy": 0.08939723670482635,
      "pose_rmse_mean": 0.24352824687957764,
      "rmse_dtheta": 0.057574719190597534,
      "rmse_dx": 0.016078362241387367,
      "rmse_dy": 0.007515809033066034,
      "rmse_mean": 0.027056297287344933,
      "rotation_flip": 0.026209676638245583,
      "sparse_tokens": 7725.0,
      "step": 476,
      "turn_loss": 0.23104122281074524,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.022161308307006133,
      "grad_norm": 0.7590392231941223,
      "learning_rate": 9.97785956789211e-06,
      "loss": 0.2855,
      "mae_dtheta": 0.03300954028964043,
      "mae_dx": 0.013007011264562607,
      "mae_dy": 0.007716569118201733,
      "pose_mae_dtheta": 0.251553475856781,
      "pose_mae_dx": 0.09726230800151825,
      "pose_mae_dy": 0.08925554156303406,
      "pose_rmse_dtheta": 0.393858939409256,
      "pose_rmse_dx": 0.19680234789848328,
      "pose_rmse_dy": 0.22093936800956726,
      "pose_rmse_mean": 0.27053356170654297,
      "rmse_dtheta": 0.04599287733435631,
      "rmse_dx": 0.025047218427062035,
      "rmse_dy": 0.013994338922202587,
      "rmse_mean": 0.028344810009002686,
      "rotation_flip": 0.021887825801968575,
      "sparse_tokens": 11795.0,
      "step": 477,
      "turn_loss": 0.3040282130241394,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.022207768072848914,
      "grad_norm": 1.0896507501602173,
      "learning_rate": 9.977735101270236e-06,
      "loss": 0.248,
      "mae_dtheta": 0.019078215584158897,
      "mae_dx": 0.005918580107390881,
      "mae_dy": 0.004020946100354195,
      "pose_mae_dtheta": 0.1365395188331604,
      "pose_mae_dx": 0.05868818610906601,
      "pose_mae_dy": 0.07044251263141632,
      "pose_rmse_dtheta": 0.20858503878116608,
      "pose_rmse_dx": 0.15854986011981964,
      "pose_rmse_dy": 0.13298399746418,
      "pose_rmse_mean": 0.16670630872249603,
      "rmse_dtheta": 0.031009728088974953,
      "rmse_dx": 0.018299274146556854,
      "rmse_dy": 0.006750515662133694,
      "rmse_mean": 0.018686506897211075,
      "rotation_flip": 0.0,
      "sparse_tokens": 2339.0,
      "step": 478,
      "turn_loss": 0.10386881977319717,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.022254227838691694,
      "grad_norm": 0.6891912817955017,
      "learning_rate": 9.977610286552672e-06,
      "loss": 0.1317,
      "mae_dtheta": 0.005109377205371857,
      "mae_dx": 0.0019358866848051548,
      "mae_dy": 0.0006710059242323041,
      "pose_mae_dtheta": 0.03614043816924095,
      "pose_mae_dx": 0.016559584066271782,
      "pose_mae_dy": 0.010108665563166142,
      "pose_rmse_dtheta": 0.099116750061512,
      "pose_rmse_dx": 0.04570646211504936,
      "pose_rmse_dy": 0.028721919283270836,
      "pose_rmse_mean": 0.05784837529063225,
      "rmse_dtheta": 0.0160202793776989,
      "rmse_dx": 0.006035306956619024,
      "rmse_dy": 0.0016170160379260778,
      "rmse_mean": 0.007890868000686169,
      "rotation_flip": 0.0010905124945566058,
      "sparse_tokens": 32185.0,
      "step": 479,
      "turn_loss": 0.056530971080064774,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.022300687604534474,
      "grad_norm": 0.9314428567886353,
      "learning_rate": 9.977485123748152e-06,
      "loss": 0.1031,
      "mae_dtheta": 0.008724457584321499,
      "mae_dx": 0.0024549930822104216,
      "mae_dy": 0.0008994980016723275,
      "pose_mae_dtheta": 0.06442219018936157,
      "pose_mae_dx": 0.021285539492964745,
      "pose_mae_dy": 0.014215264469385147,
      "pose_rmse_dtheta": 0.18749816715717316,
      "pose_rmse_dx": 0.051259320229291916,
      "pose_rmse_dy": 0.03599051386117935,
      "pose_rmse_mean": 0.09158267080783844,
      "rmse_dtheta": 0.02418769896030426,
      "rmse_dx": 0.006975209806114435,
      "rmse_dy": 0.001910924562253058,
      "rmse_mean": 0.011024611070752144,
      "rotation_flip": 0.0009191176504828036,
      "sparse_tokens": 32201.0,
      "step": 480,
      "turn_loss": 0.06038026511669159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.022347147370377254,
      "grad_norm": 0.9153729677200317,
      "learning_rate": 9.977359612865424e-06,
      "loss": 0.1501,
      "mae_dtheta": 0.013747064396739006,
      "mae_dx": 0.0028746058233082294,
      "mae_dy": 0.0031430989038199186,
      "pose_mae_dtheta": 0.09311887621879578,
      "pose_mae_dx": 0.03564373776316643,
      "pose_mae_dy": 0.0380312018096447,
      "pose_rmse_dtheta": 0.17298443615436554,
      "pose_rmse_dx": 0.08631779253482819,
      "pose_rmse_dy": 0.08102592825889587,
      "pose_rmse_mean": 0.11344271898269653,
      "rmse_dtheta": 0.02313700132071972,
      "rmse_dx": 0.008272937498986721,
      "rmse_dy": 0.00571793969720602,
      "rmse_mean": 0.012375960126519203,
      "rotation_flip": 0.003940886817872524,
      "sparse_tokens": 32121.0,
      "step": 481,
      "turn_loss": 0.11510993540287018,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.022393607136220035,
      "grad_norm": 0.5440199375152588,
      "learning_rate": 9.977233753913267e-06,
      "loss": 0.1412,
      "mae_dtheta": 0.03975031524896622,
      "mae_dx": 0.013133409433066845,
      "mae_dy": 0.005306348670274019,
      "pose_mae_dtheta": 0.333153635263443,
      "pose_mae_dx": 0.10287729650735855,
      "pose_mae_dy": 0.07839421927928925,
      "pose_rmse_dtheta": 0.5680078268051147,
      "pose_rmse_dx": 0.21089516580104828,
      "pose_rmse_dy": 0.20188167691230774,
      "pose_rmse_mean": 0.3269282281398773,
      "rmse_dtheta": 0.05799703672528267,
      "rmse_dx": 0.02503526769578457,
      "rmse_dy": 0.010932949371635914,
      "rmse_mean": 0.031321752816438675,
      "rotation_flip": 0.018584704026579857,
      "sparse_tokens": 22393.0,
      "step": 482,
      "turn_loss": 0.3010863959789276,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.022440066902062815,
      "grad_norm": 0.5333765149116516,
      "learning_rate": 9.977107546900482e-06,
      "loss": 0.1162,
      "mae_dtheta": 0.028020648285746574,
      "mae_dx": 0.010729402303695679,
      "mae_dy": 0.004571208264678717,
      "pose_mae_dtheta": 0.19158150255680084,
      "pose_mae_dx": 0.09281354397535324,
      "pose_mae_dy": 0.04690903425216675,
      "pose_rmse_dtheta": 0.3445034623146057,
      "pose_rmse_dx": 0.23372115194797516,
      "pose_rmse_dy": 0.10158586502075195,
      "pose_rmse_mean": 0.22660349309444427,
      "rmse_dtheta": 0.043900858610868454,
      "rmse_dx": 0.024123499169945717,
      "rmse_dy": 0.008603870868682861,
      "rmse_mean": 0.025542743504047394,
      "rotation_flip": 0.01209189835935831,
      "sparse_tokens": 13293.0,
      "step": 483,
      "turn_loss": 0.2997770309448242,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.022486526667905595,
      "grad_norm": 1.3231505155563354,
      "learning_rate": 9.976980991835896e-06,
      "loss": 0.2718,
      "mae_dtheta": 0.02442076802253723,
      "mae_dx": 0.011695005930960178,
      "mae_dy": 0.005697685293853283,
      "pose_mae_dtheta": 0.18510647118091583,
      "pose_mae_dx": 0.09452753514051437,
      "pose_mae_dy": 0.08595678210258484,
      "pose_rmse_dtheta": 0.32482439279556274,
      "pose_rmse_dx": 0.21400633454322815,
      "pose_rmse_dy": 0.18762105703353882,
      "pose_rmse_mean": 0.24215060472488403,
      "rmse_dtheta": 0.03972393274307251,
      "rmse_dx": 0.024945221841335297,
      "rmse_dy": 0.012418925762176514,
      "rmse_mean": 0.025696028023958206,
      "rotation_flip": 0.016597511246800423,
      "sparse_tokens": 12281.0,
      "step": 484,
      "turn_loss": 0.2426912784576416,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.022532986433748375,
      "grad_norm": 1.3059707880020142,
      "learning_rate": 9.976854088728356e-06,
      "loss": 0.153,
      "mae_dtheta": 0.03692222386598587,
      "mae_dx": 0.012948486022651196,
      "mae_dy": 0.00638266047462821,
      "pose_mae_dtheta": 0.28475990891456604,
      "pose_mae_dx": 0.09831362962722778,
      "pose_mae_dy": 0.07326722145080566,
      "pose_rmse_dtheta": 0.4379061460494995,
      "pose_rmse_dx": 0.2236568182706833,
      "pose_rmse_dy": 0.17394042015075684,
      "pose_rmse_mean": 0.27850115299224854,
      "rmse_dtheta": 0.050880275666713715,
      "rmse_dx": 0.02533998340368271,
      "rmse_dy": 0.011739364825189114,
      "rmse_mean": 0.029319874942302704,
      "rotation_flip": 0.006535947788506746,
      "sparse_tokens": 9476.0,
      "step": 485,
      "turn_loss": 0.3294006884098053,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.022579446199591156,
      "grad_norm": 0.8821921348571777,
      "learning_rate": 9.97672683758674e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.011132752522826195,
      "mae_dx": 0.002483793068677187,
      "mae_dy": 0.002947678091004491,
      "pose_mae_dtheta": 0.0780533030629158,
      "pose_mae_dx": 0.03226926550269127,
      "pose_mae_dy": 0.033164963126182556,
      "pose_rmse_dtheta": 0.18966007232666016,
      "pose_rmse_dx": 0.07687730342149734,
      "pose_rmse_dy": 0.08217253535985947,
      "pose_rmse_mean": 0.11623664200305939,
      "rmse_dtheta": 0.024084415286779404,
      "rmse_dx": 0.007119861431419849,
      "rmse_dy": 0.006193636450916529,
      "rmse_mean": 0.012465971522033215,
      "rotation_flip": 0.007017544005066156,
      "sparse_tokens": 32073.0,
      "step": 486,
      "turn_loss": 0.09218629449605942,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.022625905965433936,
      "grad_norm": 0.6663138270378113,
      "learning_rate": 9.976599238419943e-06,
      "loss": 0.1782,
      "mae_dtheta": 0.010005366057157516,
      "mae_dx": 0.001639199093915522,
      "mae_dy": 0.001918124151416123,
      "pose_mae_dtheta": 0.06875937432050705,
      "pose_mae_dx": 0.022574201226234436,
      "pose_mae_dy": 0.03044513799250126,
      "pose_rmse_dtheta": 0.1510985642671585,
      "pose_rmse_dx": 0.05471011623740196,
      "pose_rmse_dy": 0.06687403470277786,
      "pose_rmse_mean": 0.09089424461126328,
      "rmse_dtheta": 0.020908720791339874,
      "rmse_dx": 0.005124648567289114,
      "rmse_dy": 0.0036711893044412136,
      "rmse_mean": 0.009901519864797592,
      "rotation_flip": 0.0018670649733394384,
      "sparse_tokens": 32089.0,
      "step": 487,
      "turn_loss": 0.08406708389520645,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.022672365731276713,
      "grad_norm": 0.6172679662704468,
      "learning_rate": 9.97647129123689e-06,
      "loss": 0.1967,
      "mae_dtheta": 0.03225504979491234,
      "mae_dx": 0.014560394920408726,
      "mae_dy": 0.004204410128295422,
      "pose_mae_dtheta": 0.24849344789981842,
      "pose_mae_dx": 0.12465805560350418,
      "pose_mae_dy": 0.04951825737953186,
      "pose_rmse_dtheta": 0.45715469121932983,
      "pose_rmse_dx": 0.2730759382247925,
      "pose_rmse_dy": 0.1189909428358078,
      "pose_rmse_mean": 0.28307387232780457,
      "rmse_dtheta": 0.04988561570644379,
      "rmse_dx": 0.0282953642308712,
      "rmse_dy": 0.009247461333870888,
      "rmse_mean": 0.029142815619707108,
      "rotation_flip": 0.012391573749482632,
      "sparse_tokens": 14168.0,
      "step": 488,
      "turn_loss": 0.3009745180606842,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.022718825497119493,
      "grad_norm": 0.9939692616462708,
      "learning_rate": 9.976342996046532e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.025918152183294296,
      "mae_dx": 0.005376821383833885,
      "mae_dy": 0.0028665203135460615,
      "pose_mae_dtheta": 0.22032105922698975,
      "pose_mae_dx": 0.052595801651477814,
      "pose_mae_dy": 0.04269053786993027,
      "pose_rmse_dtheta": 0.48171380162239075,
      "pose_rmse_dx": 0.1274988353252411,
      "pose_rmse_dy": 0.10282059758901596,
      "pose_rmse_mean": 0.2373444139957428,
      "rmse_dtheta": 0.04688889905810356,
      "rmse_dx": 0.0132408132776618,
      "rmse_dy": 0.005339509341865778,
      "rmse_mean": 0.02182307466864586,
      "rotation_flip": 0.0030674845911562443,
      "sparse_tokens": 5309.0,
      "step": 489,
      "turn_loss": 0.22649399936199188,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.022765285262962273,
      "grad_norm": 0.8582116961479187,
      "learning_rate": 9.976214352857835e-06,
      "loss": 0.1508,
      "mae_dtheta": 0.04020689055323601,
      "mae_dx": 0.012563501484692097,
      "mae_dy": 0.004330681171268225,
      "pose_mae_dtheta": 0.35733669996261597,
      "pose_mae_dx": 0.1049661636352539,
      "pose_mae_dy": 0.06608080118894577,
      "pose_rmse_dtheta": 0.5860520601272583,
      "pose_rmse_dx": 0.2499532699584961,
      "pose_rmse_dy": 0.1401139795780182,
      "pose_rmse_mean": 0.325373113155365,
      "rmse_dtheta": 0.05912451446056366,
      "rmse_dx": 0.026030588895082474,
      "rmse_dy": 0.007589573040604591,
      "rmse_mean": 0.03091489151120186,
      "rotation_flip": 0.009009009227156639,
      "sparse_tokens": 6200.0,
      "step": 490,
      "turn_loss": 0.3098241686820984,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.022811745028805053,
      "grad_norm": 0.5399091243743896,
      "learning_rate": 9.976085361679797e-06,
      "loss": 0.1822,
      "mae_dtheta": 0.021332569420337677,
      "mae_dx": 0.006912072189152241,
      "mae_dy": 0.0031663046684116125,
      "pose_mae_dtheta": 0.1357419192790985,
      "pose_mae_dx": 0.05798890441656113,
      "pose_mae_dy": 0.04031778499484062,
      "pose_rmse_dtheta": 0.2932435870170593,
      "pose_rmse_dx": 0.16308510303497314,
      "pose_rmse_dy": 0.09150484949350357,
      "pose_rmse_mean": 0.18261119723320007,
      "rmse_dtheta": 0.038466282188892365,
      "rmse_dx": 0.018702039495110512,
      "rmse_dy": 0.006649085786193609,
      "rmse_mean": 0.02127246931195259,
      "rotation_flip": 0.011688311584293842,
      "sparse_tokens": 18269.0,
      "step": 491,
      "turn_loss": 0.19412794709205627,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.022858204794647834,
      "grad_norm": 0.4513387084007263,
      "learning_rate": 9.975956022521441e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.012133314274251461,
      "mae_dx": 0.003215006785467267,
      "mae_dy": 0.003638371592387557,
      "pose_mae_dtheta": 0.08334441483020782,
      "pose_mae_dx": 0.03832195699214935,
      "pose_mae_dy": 0.0380285382270813,
      "pose_rmse_dtheta": 0.18040695786476135,
      "pose_rmse_dx": 0.09682852029800415,
      "pose_rmse_dy": 0.09189311414957047,
      "pose_rmse_mean": 0.12304286658763885,
      "rmse_dtheta": 0.02404828555881977,
      "rmse_dx": 0.009187538176774979,
      "rmse_dy": 0.008658843114972115,
      "rmse_mean": 0.013964889571070671,
      "rotation_flip": 0.0026861089281737804,
      "sparse_tokens": 32105.0,
      "step": 492,
      "turn_loss": 0.11078327894210815,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 63514.0,
      "epoch": 0.022904664560490614,
      "grad_norm": 0.6362159252166748,
      "learning_rate": 9.975826335391808e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.016212109476327896,
      "mae_dx": 0.002699941396713257,
      "mae_dy": 0.004290136508643627,
      "pose_mae_dtheta": 0.11591331660747528,
      "pose_mae_dx": 0.03793851286172867,
      "pose_mae_dy": 0.05251536890864372,
      "pose_rmse_dtheta": 0.23380903899669647,
      "pose_rmse_dx": 0.09621965140104294,
      "pose_rmse_dy": 0.13621753454208374,
      "pose_rmse_mean": 0.15541541576385498,
      "rmse_dtheta": 0.028943585231900215,
      "rmse_dx": 0.007566414307802916,
      "rmse_dy": 0.009240048937499523,
      "rmse_mean": 0.015250016003847122,
      "rotation_flip": 0.0037983425427228212,
      "sparse_tokens": 32014.0,
      "step": 493,
      "turn_loss": 0.11956746131181717,
      "turns": 195.0,
      "turns_per_sample": 195.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.022951124326333394,
      "grad_norm": 0.4386022090911865,
      "learning_rate": 9.975696300299969e-06,
      "loss": 0.1307,
      "mae_dtheta": 0.011435254476964474,
      "mae_dx": 0.0024782803375273943,
      "mae_dy": 0.0031773655209690332,
      "pose_mae_dtheta": 0.07578033208847046,
      "pose_mae_dx": 0.03482459485530853,
      "pose_mae_dy": 0.03760826587677002,
      "pose_rmse_dtheta": 0.16229403018951416,
      "pose_rmse_dx": 0.08967998623847961,
      "pose_rmse_dy": 0.08590789884328842,
      "pose_rmse_mean": 0.112627312541008,
      "rmse_dtheta": 0.02363971248269081,
      "rmse_dx": 0.0078095942735672,
      "rmse_dy": 0.006900346837937832,
      "rmse_mean": 0.012783218175172806,
      "rotation_flip": 0.005154639016836882,
      "sparse_tokens": 32057.0,
      "step": 494,
      "turn_loss": 0.11115653812885284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.022997584092176174,
      "grad_norm": 0.4653802812099457,
      "learning_rate": 9.975565917255017e-06,
      "loss": 0.1751,
      "mae_dtheta": 0.029174353927373886,
      "mae_dx": 0.015325352549552917,
      "mae_dy": 0.003451653989031911,
      "pose_mae_dtheta": 0.2345992773771286,
      "pose_mae_dx": 0.13585488498210907,
      "pose_mae_dy": 0.04034220427274704,
      "pose_rmse_dtheta": 0.38495317101478577,
      "pose_rmse_dx": 0.26683053374290466,
      "pose_rmse_dy": 0.09085255116224289,
      "pose_rmse_mean": 0.24754542112350464,
      "rmse_dtheta": 0.0436272993683815,
      "rmse_dx": 0.02803998999297619,
      "rmse_dy": 0.006641269661486149,
      "rmse_mean": 0.026102853938937187,
      "rotation_flip": 0.0,
      "sparse_tokens": 7437.0,
      "step": 495,
      "turn_loss": 0.2422494739294052,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.023044043858018955,
      "grad_norm": 0.6845141053199768,
      "learning_rate": 9.975435186266069e-06,
      "loss": 0.1773,
      "mae_dtheta": 0.014325549826025963,
      "mae_dx": 0.004093038383871317,
      "mae_dy": 0.0034663216210901737,
      "pose_mae_dtheta": 0.10726684331893921,
      "pose_mae_dx": 0.03593471646308899,
      "pose_mae_dy": 0.033851779997348785,
      "pose_rmse_dtheta": 0.26141807436943054,
      "pose_rmse_dx": 0.08378347754478455,
      "pose_rmse_dy": 0.08880244195461273,
      "pose_rmse_mean": 0.14466801285743713,
      "rmse_dtheta": 0.03229973092675209,
      "rmse_dx": 0.011293287388980389,
      "rmse_dy": 0.009785867296159267,
      "rmse_mean": 0.0177929624915123,
      "rotation_flip": 0.009983360767364502,
      "sparse_tokens": 32137.0,
      "step": 496,
      "turn_loss": 0.14673060178756714,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.023090503623861735,
      "grad_norm": 0.52325439453125,
      "learning_rate": 9.975304107342268e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.011913375928997993,
      "mae_dx": 0.0018602001946419477,
      "mae_dy": 0.002781393937766552,
      "pose_mae_dtheta": 0.08689680695533752,
      "pose_mae_dx": 0.03118138201534748,
      "pose_mae_dy": 0.0387745201587677,
      "pose_rmse_dtheta": 0.20733369886875153,
      "pose_rmse_dx": 0.0847407877445221,
      "pose_rmse_dy": 0.09822480380535126,
      "pose_rmse_mean": 0.13009977340698242,
      "rmse_dtheta": 0.025865444913506508,
      "rmse_dx": 0.005010710097849369,
      "rmse_dy": 0.0061711897142231464,
      "rmse_mean": 0.012349115684628487,
      "rotation_flip": 0.0016467681853100657,
      "sparse_tokens": 32105.0,
      "step": 497,
      "turn_loss": 0.09782496094703674,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.023136963389704515,
      "grad_norm": 0.6204627156257629,
      "learning_rate": 9.975172680492782e-06,
      "loss": 0.1376,
      "mae_dtheta": 0.03322608768939972,
      "mae_dx": 0.013758241198956966,
      "mae_dy": 0.004447374492883682,
      "pose_mae_dtheta": 0.2766570746898651,
      "pose_mae_dx": 0.11178861558437347,
      "pose_mae_dy": 0.06519611924886703,
      "pose_rmse_dtheta": 0.4843028783798218,
      "pose_rmse_dx": 0.24991053342819214,
      "pose_rmse_dy": 0.14083316922187805,
      "pose_rmse_mean": 0.2916822135448456,
      "rmse_dtheta": 0.0511087104678154,
      "rmse_dx": 0.027824856340885162,
      "rmse_dy": 0.00810327474027872,
      "rmse_mean": 0.029012281447649002,
      "rotation_flip": 0.008639308623969555,
      "sparse_tokens": 9647.0,
      "step": 498,
      "turn_loss": 0.2685070037841797,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.023183423155547295,
      "grad_norm": 0.45983946323394775,
      "learning_rate": 9.975040905726799e-06,
      "loss": 0.1564,
      "mae_dtheta": 0.01046733558177948,
      "mae_dx": 0.0025480010081082582,
      "mae_dy": 0.00037641124799847603,
      "pose_mae_dtheta": 0.08084210753440857,
      "pose_mae_dx": 0.02044323831796646,
      "pose_mae_dy": 0.005986219272017479,
      "pose_rmse_dtheta": 0.28807953000068665,
      "pose_rmse_dx": 0.04813004657626152,
      "pose_rmse_dy": 0.01244648639112711,
      "pose_rmse_mean": 0.1162186861038208,
      "rmse_dtheta": 0.033024176955223083,
      "rmse_dx": 0.0067887562327086926,
      "rmse_dy": 0.0006488767103292048,
      "rmse_mean": 0.013487271033227444,
      "rotation_flip": 0.0038759689778089523,
      "sparse_tokens": 32217.0,
      "step": 499,
      "turn_loss": 0.05365660786628723,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.023229882921390076,
      "grad_norm": 0.69603031873703,
      "learning_rate": 9.974908783053535e-06,
      "loss": 0.1422,
      "mae_dtheta": 0.013472145423293114,
      "mae_dx": 0.003145584836602211,
      "mae_dy": 0.0028157371561974287,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6960303783416748,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.717041015625,
      "model/head/act_norm_mean": 114.53803661616162,
      "model/head/act_norm_min": 59.807350158691406,
      "model/head/act_over_embed": 78.71161108461978,
      "model/head/grad_frac": 0.10552561283111572,
      "model/head/grad_norm": 0.0734490305185318,
      "model/head/grad_zero_frac": 0.0001738649298204109,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6797269570707071,
      "model/head/update_ratio": 0.0012848888291046023,
      "model/head/weight_delta": 2.5535881519317627,
      "model/head/weight_delta_rel": 0.04479749873280525,
      "model/head/weight_norm": 57.16372299194336,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4102875292301178,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4102077570436227,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41014328598976135,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28189861106590586,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0951998233795166,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06626196950674057,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5006363122171946,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002162333345040679,
      "model/modality_embedder.encoders.pose/weight_delta": 0.7249712944030762,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.023687072098255157,
      "model/modality_embedder.encoders.pose/weight_norm": 30.643735885620117,
      "model/modality_embedder/grad_frac": 0.0951998233795166,
      "model/modality_embedder/grad_norm": 0.06626196950674057,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5006363122171946,
      "model/modality_embedder/update_ratio": 0.002162333345040679,
      "model/modality_embedder/weight_delta": 0.7249712944030762,
      "model/modality_embedder/weight_delta_rel": 0.023687072098255157,
      "model/modality_embedder/weight_norm": 30.643735885620117,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.17202758789062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.69331459435626,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.840453147888184,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.28226760954769,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09796495735645294,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06818658858537674,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002481424016878009,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.34473884105682373,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.012562490999698639,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.47881507873535,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.60009002685547,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.752835898669233,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.229334831237793,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.0103805692663,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10021024197340012,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0697493702173233,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0024104116018861532,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.3953017294406891,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.013693560846149921,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.936704635620117,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.41085815429688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.69211209315376,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 11.988500595092773,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.343069325905848,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10494019091129303,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07304155826568604,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0024464221205562353,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.4002791941165924,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.013440625742077827,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.856481552124023,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.13045501708984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.575316658649992,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.733877182006836,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.63722513415378,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1043413057923317,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07262472063302994,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0024772975593805313,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.332216739654541,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.011353591457009315,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.31610679626465,
      "model/normalizer/grad_frac": 0.3512382507324219,
      "model/normalizer/grad_norm": 0.24447248876094818,
      "model/normalizer/grad_zero_frac": 0.00014062687114346772,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0031455056741833687,
      "model/normalizer/weight_delta": 0.7600581645965576,
      "model/normalizer/weight_delta_rel": 0.009789109230041504,
      "model/normalizer/weight_norm": 77.72120666503906,
      "pose_mae_dtheta": 0.09789310395717621,
      "pose_mae_dx": 0.04093397036194801,
      "pose_mae_dy": 0.04064379259943962,
      "pose_rmse_dtheta": 0.22407841682434082,
      "pose_rmse_dx": 0.12323412299156189,
      "pose_rmse_dy": 0.11202659457921982,
      "pose_rmse_mean": 0.15311305224895477,
      "rmse_dtheta": 0.02779771015048027,
      "rmse_dx": 0.009962356649339199,
      "rmse_dy": 0.00746276555582881,
      "rmse_mean": 0.015074278227984905,
      "rotation_flip": 0.012179207988083363,
      "sparse_tokens": 32089.0,
      "step": 500,
      "turn_loss": 0.11692053824663162,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.023276342687232856,
      "grad_norm": 0.6025434732437134,
      "learning_rate": 9.97477631248223e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.047761619091033936,
      "mae_dx": 0.012953342869877815,
      "mae_dy": 0.004121935926377773,
      "pose_mae_dtheta": 0.4253620505332947,
      "pose_mae_dx": 0.09463639557361603,
      "pose_mae_dy": 0.062389642000198364,
      "pose_rmse_dtheta": 0.6812621355056763,
      "pose_rmse_dx": 0.2016974687576294,
      "pose_rmse_dy": 0.1427375078201294,
      "pose_rmse_mean": 0.341899037361145,
      "rmse_dtheta": 0.06754661351442337,
      "rmse_dx": 0.024806614965200424,
      "rmse_dy": 0.008103091269731522,
      "rmse_mean": 0.03348543867468834,
      "rotation_flip": 0.007256893906742334,
      "sparse_tokens": 10948.0,
      "step": 501,
      "turn_loss": 0.31395089626312256,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.023322802453075636,
      "grad_norm": 0.4828643798828125,
      "learning_rate": 9.974643494022146e-06,
      "loss": 0.1212,
      "mae_dtheta": 0.007921111769974232,
      "mae_dx": 0.0021514107938855886,
      "mae_dy": 0.000428698054747656,
      "pose_mae_dtheta": 0.06119653210043907,
      "pose_mae_dx": 0.019133057445287704,
      "pose_mae_dy": 0.008200488984584808,
      "pose_rmse_dtheta": 0.2544032633304596,
      "pose_rmse_dx": 0.050550226122140884,
      "pose_rmse_dy": 0.023349301889538765,
      "pose_rmse_mean": 0.10943426936864853,
      "rmse_dtheta": 0.028220444917678833,
      "rmse_dx": 0.006666276138275862,
      "rmse_dy": 0.0010548548307269812,
      "rmse_mean": 0.011980525217950344,
      "rotation_flip": 0.002680965233594179,
      "sparse_tokens": 32105.0,
      "step": 502,
      "turn_loss": 0.044918157160282135,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.023369262218918416,
      "grad_norm": 0.48399803042411804,
      "learning_rate": 9.974510327682575e-06,
      "loss": 0.1671,
      "mae_dtheta": 0.02730441279709339,
      "mae_dx": 0.010581116192042828,
      "mae_dy": 0.00443641422316432,
      "pose_mae_dtheta": 0.216488778591156,
      "pose_mae_dx": 0.0859685018658638,
      "pose_mae_dy": 0.049289602786302567,
      "pose_rmse_dtheta": 0.4111042618751526,
      "pose_rmse_dx": 0.18382517993450165,
      "pose_rmse_dy": 0.10985179245471954,
      "pose_rmse_mean": 0.23492708802223206,
      "rmse_dtheta": 0.043887801468372345,
      "rmse_dx": 0.02116783894598484,
      "rmse_dy": 0.008744939230382442,
      "rmse_mean": 0.02460019290447235,
      "rotation_flip": 0.0160857904702425,
      "sparse_tokens": 11853.0,
      "step": 503,
      "turn_loss": 0.2544078230857849,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.023415721984761197,
      "grad_norm": 0.6142265200614929,
      "learning_rate": 9.974376813472826e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.011423895135521889,
      "mae_dx": 0.002469155238941312,
      "mae_dy": 0.003468118142336607,
      "pose_mae_dtheta": 0.08881963789463043,
      "pose_mae_dx": 0.03880792111158371,
      "pose_mae_dy": 0.04394770786166191,
      "pose_rmse_dtheta": 0.17021583020687103,
      "pose_rmse_dx": 0.08837009966373444,
      "pose_rmse_dy": 0.10034225136041641,
      "pose_rmse_mean": 0.1196427270770073,
      "rmse_dtheta": 0.02028503268957138,
      "rmse_dx": 0.005957374814897776,
      "rmse_dy": 0.006838598288595676,
      "rmse_mean": 0.011027002707123756,
      "rotation_flip": 0.0031903579365462065,
      "sparse_tokens": 32137.0,
      "step": 504,
      "turn_loss": 0.10022535175085068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.023462181750603977,
      "grad_norm": 0.6352207660675049,
      "learning_rate": 9.974242951402236e-06,
      "loss": 0.1982,
      "mae_dtheta": 0.012790904380381107,
      "mae_dx": 0.0017982375575229526,
      "mae_dy": 0.0033268581610172987,
      "pose_mae_dtheta": 0.08898714929819107,
      "pose_mae_dx": 0.031223181635141373,
      "pose_mae_dy": 0.04490791633725166,
      "pose_rmse_dtheta": 0.1810818761587143,
      "pose_rmse_dx": 0.07695576548576355,
      "pose_rmse_dy": 0.09487012773752213,
      "pose_rmse_mean": 0.11763592064380646,
      "rmse_dtheta": 0.023917585611343384,
      "rmse_dx": 0.005138123873621225,
      "rmse_dy": 0.0066218008287250996,
      "rmse_mean": 0.011892504058778286,
      "rotation_flip": 0.00430879695340991,
      "sparse_tokens": 32057.0,
      "step": 505,
      "turn_loss": 0.1099885106086731,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.023508641516446757,
      "grad_norm": 0.6774537563323975,
      "learning_rate": 9.974108741480167e-06,
      "loss": 0.2468,
      "mae_dtheta": 0.02108813263475895,
      "mae_dx": 0.005012650974094868,
      "mae_dy": 0.0030560120940208435,
      "pose_mae_dtheta": 0.16152432560920715,
      "pose_mae_dx": 0.04891987890005112,
      "pose_mae_dy": 0.03674259036779404,
      "pose_rmse_dtheta": 0.37965553998947144,
      "pose_rmse_dx": 0.14642737805843353,
      "pose_rmse_dy": 0.13759377598762512,
      "pose_rmse_mean": 0.2212255895137787,
      "rmse_dtheta": 0.04267426207661629,
      "rmse_dx": 0.014776600524783134,
      "rmse_dy": 0.009152346290647984,
      "rmse_mean": 0.022201068699359894,
      "rotation_flip": 0.006535947788506746,
      "sparse_tokens": 6911.0,
      "step": 506,
      "turn_loss": 0.1194976195693016,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 16189.0,
      "epoch": 0.023555101282289537,
      "grad_norm": 0.8028178811073303,
      "learning_rate": 9.973974183716002e-06,
      "loss": 0.096,
      "mae_dtheta": 0.033067259937524796,
      "mae_dx": 0.016171736642718315,
      "mae_dy": 0.004660787060856819,
      "pose_mae_dtheta": 0.25032657384872437,
      "pose_mae_dx": 0.12630148231983185,
      "pose_mae_dy": 0.06996561586856842,
      "pose_rmse_dtheta": 0.45133140683174133,
      "pose_rmse_dx": 0.24299687147140503,
      "pose_rmse_dy": 0.15226510167121887,
      "pose_rmse_mean": 0.2821978032588959,
      "rmse_dtheta": 0.050772588700056076,
      "rmse_dx": 0.029104655608534813,
      "rmse_dy": 0.00736590102314949,
      "rmse_mean": 0.02908104658126831,
      "rotation_flip": 0.006684491876512766,
      "sparse_tokens": 13169.0,
      "step": 507,
      "turn_loss": 0.26257047057151794,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.023601561048132318,
      "grad_norm": 0.6864185333251953,
      "learning_rate": 9.973839278119154e-06,
      "loss": 0.1838,
      "mae_dtheta": 0.03215475380420685,
      "mae_dx": 0.01193224173039198,
      "mae_dy": 0.006672936491668224,
      "pose_mae_dtheta": 0.2300211638212204,
      "pose_mae_dx": 0.10057098418474197,
      "pose_mae_dy": 0.06969107687473297,
      "pose_rmse_dtheta": 0.4030567407608032,
      "pose_rmse_dx": 0.22541603446006775,
      "pose_rmse_dy": 0.16335301101207733,
      "pose_rmse_mean": 0.2639419436454773,
      "rmse_dtheta": 0.050832368433475494,
      "rmse_dx": 0.024446820840239525,
      "rmse_dy": 0.014384179376065731,
      "rmse_mean": 0.029887791723012924,
      "rotation_flip": 0.011816838756203651,
      "sparse_tokens": 11948.0,
      "step": 508,
      "turn_loss": 0.2985893189907074,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.023648020813975098,
      "grad_norm": 0.741175651550293,
      "learning_rate": 9.973704024699056e-06,
      "loss": 0.133,
      "mae_dtheta": 0.0401734821498394,
      "mae_dx": 0.013698208145797253,
      "mae_dy": 0.005701256450265646,
      "pose_mae_dtheta": 0.3115055561065674,
      "pose_mae_dx": 0.12206196039915085,
      "pose_mae_dy": 0.07775788754224777,
      "pose_rmse_dtheta": 0.49428632855415344,
      "pose_rmse_dx": 0.252238929271698,
      "pose_rmse_dy": 0.16533580422401428,
      "pose_rmse_mean": 0.30395370721817017,
      "rmse_dtheta": 0.05560382828116417,
      "rmse_dx": 0.025703739374876022,
      "rmse_dy": 0.011205061338841915,
      "rmse_mean": 0.030837543308734894,
      "rotation_flip": 0.013089004904031754,
      "sparse_tokens": 6754.0,
      "step": 509,
      "turn_loss": 0.2633167803287506,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.023694480579817878,
      "grad_norm": 0.5556334853172302,
      "learning_rate": 9.973568423465167e-06,
      "loss": 0.122,
      "mae_dtheta": 0.011242850683629513,
      "mae_dx": 0.0014509429456666112,
      "mae_dy": 0.002686605090275407,
      "pose_mae_dtheta": 0.07524003088474274,
      "pose_mae_dx": 0.025116054341197014,
      "pose_mae_dy": 0.0351392962038517,
      "pose_rmse_dtheta": 0.15975068509578705,
      "pose_rmse_dx": 0.06330186873674393,
      "pose_rmse_dy": 0.07264512777328491,
      "pose_rmse_mean": 0.09856589883565903,
      "rmse_dtheta": 0.02128574624657631,
      "rmse_dx": 0.004125769715756178,
      "rmse_dy": 0.005231430754065514,
      "rmse_mean": 0.010214315727353096,
      "rotation_flip": 0.005673758685588837,
      "sparse_tokens": 32073.0,
      "step": 510,
      "turn_loss": 0.10518871992826462,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.02374094034566066,
      "grad_norm": 0.5881144404411316,
      "learning_rate": 9.973432474426968e-06,
      "loss": 0.1158,
      "mae_dtheta": 0.00931384414434433,
      "mae_dx": 0.002182361902669072,
      "mae_dy": 0.001496313838288188,
      "pose_mae_dtheta": 0.0646892786026001,
      "pose_mae_dx": 0.021722614765167236,
      "pose_mae_dy": 0.016994569450616837,
      "pose_rmse_dtheta": 0.2108987271785736,
      "pose_rmse_dx": 0.05410938337445259,
      "pose_rmse_dy": 0.0482083335518837,
      "pose_rmse_mean": 0.1044054850935936,
      "rmse_dtheta": 0.025917455554008484,
      "rmse_dx": 0.0062987771816551685,
      "rmse_dy": 0.0036914499942213297,
      "rmse_mean": 0.011969227343797684,
      "rotation_flip": 0.005167958792299032,
      "sparse_tokens": 32105.0,
      "step": 511,
      "turn_loss": 0.08308466523885727,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.02378740011150344,
      "grad_norm": 0.5765528678894043,
      "learning_rate": 9.973296177593965e-06,
      "loss": 0.0932,
      "mae_dtheta": 0.05468130111694336,
      "mae_dx": 0.022774623706936836,
      "mae_dy": 0.005714285187423229,
      "pose_mae_dtheta": 0.4976017475128174,
      "pose_mae_dx": 0.1772812157869339,
      "pose_mae_dy": 0.08127054572105408,
      "pose_rmse_dtheta": 0.739777147769928,
      "pose_rmse_dx": 0.2900468111038208,
      "pose_rmse_dy": 0.16321513056755066,
      "pose_rmse_mean": 0.39767974615097046,
      "rmse_dtheta": 0.07087922841310501,
      "rmse_dx": 0.033618658781051636,
      "rmse_dy": 0.009832100011408329,
      "rmse_mean": 0.03810999542474747,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 4218.0,
      "step": 512,
      "turn_loss": 0.40439027547836304,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 9435.0,
      "epoch": 0.02383385987734622,
      "grad_norm": 0.4117594063282013,
      "learning_rate": 9.973159532975691e-06,
      "loss": 0.0972,
      "mae_dtheta": 0.03325747326016426,
      "mae_dx": 0.010262226685881615,
      "mae_dy": 0.0027589828241616488,
      "pose_mae_dtheta": 0.280019074678421,
      "pose_mae_dx": 0.07058817148208618,
      "pose_mae_dy": 0.032995518296957016,
      "pose_rmse_dtheta": 0.4778197407722473,
      "pose_rmse_dx": 0.17561006546020508,
      "pose_rmse_dy": 0.09039079397916794,
      "pose_rmse_mean": 0.24794021248817444,
      "rmse_dtheta": 0.05388449504971504,
      "rmse_dx": 0.02309802547097206,
      "rmse_dy": 0.0062124039977788925,
      "rmse_mean": 0.02773164212703705,
      "rotation_flip": 0.0190677959471941,
      "sparse_tokens": 7348.0,
      "step": 513,
      "turn_loss": 0.22852978110313416,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 30077.0,
      "epoch": 0.023880319643189,
      "grad_norm": 0.974266529083252,
      "learning_rate": 9.973022540581703e-06,
      "loss": 0.3189,
      "mae_dtheta": 0.043097592890262604,
      "mae_dx": 0.016895992681384087,
      "mae_dy": 0.007169945631176233,
      "pose_mae_dtheta": 0.35219308733940125,
      "pose_mae_dx": 0.1445682942867279,
      "pose_mae_dy": 0.09072534739971161,
      "pose_rmse_dtheta": 0.5544429421424866,
      "pose_rmse_dx": 0.27882060408592224,
      "pose_rmse_dy": 0.18096499145030975,
      "pose_rmse_mean": 0.3380761742591858,
      "rmse_dtheta": 0.05913802608847618,
      "rmse_dx": 0.030411459505558014,
      "rmse_dy": 0.012392756529152393,
      "rmse_mean": 0.03398074954748154,
      "rotation_flip": 0.01894736848771572,
      "sparse_tokens": 24971.0,
      "step": 514,
      "turn_loss": 0.3484334945678711,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.02392677940903178,
      "grad_norm": 0.7502688765525818,
      "learning_rate": 9.97288520042158e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.03675001859664917,
      "mae_dx": 0.010717611759901047,
      "mae_dy": 0.005456919781863689,
      "pose_mae_dtheta": 0.3248240351676941,
      "pose_mae_dx": 0.10264920443296432,
      "pose_mae_dy": 0.08244480192661285,
      "pose_rmse_dtheta": 0.5798806548118591,
      "pose_rmse_dx": 0.23171013593673706,
      "pose_rmse_dy": 0.19055631756782532,
      "pose_rmse_mean": 0.3340490460395813,
      "rmse_dtheta": 0.05561156943440437,
      "rmse_dx": 0.023031366989016533,
      "rmse_dy": 0.0098379822447896,
      "rmse_mean": 0.02949364110827446,
      "rotation_flip": 0.010971786454319954,
      "sparse_tokens": 10476.0,
      "step": 515,
      "turn_loss": 0.2627675533294678,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.02397323917487456,
      "grad_norm": 1.0530147552490234,
      "learning_rate": 9.972747512504925e-06,
      "loss": 0.1727,
      "mae_dtheta": 0.03569589555263519,
      "mae_dx": 0.014038914814591408,
      "mae_dy": 0.005790278315544128,
      "pose_mae_dtheta": 0.294398695230484,
      "pose_mae_dx": 0.09292520582675934,
      "pose_mae_dy": 0.08900640904903412,
      "pose_rmse_dtheta": 0.5326069593429565,
      "pose_rmse_dx": 0.19848641753196716,
      "pose_rmse_dy": 0.1852758377790451,
      "pose_rmse_mean": 0.3054564297199249,
      "rmse_dtheta": 0.05410469323396683,
      "rmse_dx": 0.02691710740327835,
      "rmse_dy": 0.009234178811311722,
      "rmse_mean": 0.030085325241088867,
      "rotation_flip": 0.01337792631238699,
      "sparse_tokens": 10077.0,
      "step": 516,
      "turn_loss": 0.22448720037937164,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.02401969894071734,
      "grad_norm": 0.8110017776489258,
      "learning_rate": 9.972609476841368e-06,
      "loss": 0.1808,
      "mae_dtheta": 0.009421787224709988,
      "mae_dx": 0.002627096837386489,
      "mae_dy": 0.002187472302466631,
      "pose_mae_dtheta": 0.07211088389158249,
      "pose_mae_dx": 0.03150869160890579,
      "pose_mae_dy": 0.030986832454800606,
      "pose_rmse_dtheta": 0.152398943901062,
      "pose_rmse_dx": 0.0714491754770279,
      "pose_rmse_dy": 0.08042880892753601,
      "pose_rmse_mean": 0.1014256477355957,
      "rmse_dtheta": 0.01996920257806778,
      "rmse_dx": 0.006795734632760286,
      "rmse_dy": 0.004972366616129875,
      "rmse_mean": 0.010579101741313934,
      "rotation_flip": 0.0038207711186259985,
      "sparse_tokens": 32201.0,
      "step": 517,
      "turn_loss": 0.0811142846941948,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.02406615870656012,
      "grad_norm": 0.4903392195701599,
      "learning_rate": 9.97247109344056e-06,
      "loss": 0.1253,
      "mae_dtheta": 0.01660982333123684,
      "mae_dx": 0.0027963912580162287,
      "mae_dy": 0.0029127136804163456,
      "pose_mae_dtheta": 0.11427851766347885,
      "pose_mae_dx": 0.03547941893339157,
      "pose_mae_dy": 0.037016913294792175,
      "pose_rmse_dtheta": 0.25414803624153137,
      "pose_rmse_dx": 0.07540881633758545,
      "pose_rmse_dy": 0.10546218603849411,
      "pose_rmse_mean": 0.14500635862350464,
      "rmse_dtheta": 0.030318118631839752,
      "rmse_dx": 0.007399373687803745,
      "rmse_dy": 0.005997334606945515,
      "rmse_mean": 0.01457160897552967,
      "rotation_flip": 0.01033210288733244,
      "sparse_tokens": 32089.0,
      "step": 518,
      "turn_loss": 0.15784022212028503,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.0241126184724029,
      "grad_norm": 0.5513036847114563,
      "learning_rate": 9.97233236231218e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.038378652185201645,
      "mae_dx": 0.014979624189436436,
      "mae_dy": 0.004642709158360958,
      "pose_mae_dtheta": 0.331559419631958,
      "pose_mae_dx": 0.11817760020494461,
      "pose_mae_dy": 0.060384415090084076,
      "pose_rmse_dtheta": 0.525592029094696,
      "pose_rmse_dx": 0.23692119121551514,
      "pose_rmse_dy": 0.1401795595884323,
      "pose_rmse_mean": 0.30089759826660156,
      "rmse_dtheta": 0.05597071349620819,
      "rmse_dx": 0.02723088674247265,
      "rmse_dy": 0.01077757403254509,
      "rmse_mean": 0.03132639452815056,
      "rotation_flip": 0.013836477883160114,
      "sparse_tokens": 11706.0,
      "step": 519,
      "turn_loss": 0.33318111300468445,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 11379.0,
      "epoch": 0.02415907823824568,
      "grad_norm": 0.48950445652008057,
      "learning_rate": 9.97219328346593e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.03431173786520958,
      "mae_dx": 0.013160930015146732,
      "mae_dy": 0.0056801410391926765,
      "pose_mae_dtheta": 0.2297489494085312,
      "pose_mae_dx": 0.10834498703479767,
      "pose_mae_dy": 0.06498659402132034,
      "pose_rmse_dtheta": 0.438058078289032,
      "pose_rmse_dx": 0.24119819700717926,
      "pose_rmse_dy": 0.1602504551410675,
      "pose_rmse_mean": 0.27983558177948,
      "rmse_dtheta": 0.051911722868680954,
      "rmse_dx": 0.02599508874118328,
      "rmse_dy": 0.009928056038916111,
      "rmse_mean": 0.029278289526700974,
      "rotation_flip": 0.014184396713972092,
      "sparse_tokens": 9508.0,
      "step": 520,
      "turn_loss": 0.29909396171569824,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.02420553800408846,
      "grad_norm": 0.6287589073181152,
      "learning_rate": 9.972053856911534e-06,
      "loss": 0.1649,
      "mae_dtheta": 0.036187369376420975,
      "mae_dx": 0.012645410373806953,
      "mae_dy": 0.009572998620569706,
      "pose_mae_dtheta": 0.2581467032432556,
      "pose_mae_dx": 0.11342044174671173,
      "pose_mae_dy": 0.0786900520324707,
      "pose_rmse_dtheta": 0.4280475974082947,
      "pose_rmse_dx": 0.2239745557308197,
      "pose_rmse_dy": 0.15349291265010834,
      "pose_rmse_mean": 0.2685050368309021,
      "rmse_dtheta": 0.05247213691473007,
      "rmse_dx": 0.0232682041823864,
      "rmse_dy": 0.01882813684642315,
      "rmse_mean": 0.03152282536029816,
      "rotation_flip": 0.01508620660752058,
      "sparse_tokens": 16022.0,
      "step": 521,
      "turn_loss": 0.41500893235206604,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.02425199776993124,
      "grad_norm": 0.88298100233078,
      "learning_rate": 9.971914082658745e-06,
      "loss": 0.1467,
      "mae_dtheta": 0.04060345143079758,
      "mae_dx": 0.012219526804983616,
      "mae_dy": 0.0035984923597425222,
      "pose_mae_dtheta": 0.3541320562362671,
      "pose_mae_dx": 0.10559418797492981,
      "pose_mae_dy": 0.0361751914024353,
      "pose_rmse_dtheta": 0.587408721446991,
      "pose_rmse_dx": 0.22797460854053497,
      "pose_rmse_dy": 0.09626112878322601,
      "pose_rmse_mean": 0.3038814961910248,
      "rmse_dtheta": 0.059435006231069565,
      "rmse_dx": 0.02341063693165779,
      "rmse_dy": 0.008516359142959118,
      "rmse_mean": 0.0304540004581213,
      "rotation_flip": 0.02391304261982441,
      "sparse_tokens": 7754.0,
      "step": 522,
      "turn_loss": 0.24487735331058502,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.02429845753577402,
      "grad_norm": 0.5054923892021179,
      "learning_rate": 9.971773960717333e-06,
      "loss": 0.1177,
      "mae_dtheta": 0.012584592215716839,
      "mae_dx": 0.002346215071156621,
      "mae_dy": 0.003130196826532483,
      "pose_mae_dtheta": 0.09493241459131241,
      "pose_mae_dx": 0.031452856957912445,
      "pose_mae_dy": 0.038906387984752655,
      "pose_rmse_dtheta": 0.2460021674633026,
      "pose_rmse_dx": 0.08065186440944672,
      "pose_rmse_dy": 0.13175740838050842,
      "pose_rmse_mean": 0.15280380845069885,
      "rmse_dtheta": 0.028376596048474312,
      "rmse_dx": 0.006556190084666014,
      "rmse_dy": 0.0075707342475652695,
      "rmse_mean": 0.014167840592563152,
      "rotation_flip": 0.004048583097755909,
      "sparse_tokens": 32073.0,
      "step": 523,
      "turn_loss": 0.1026930883526802,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.024344917301616798,
      "grad_norm": 0.46069103479385376,
      "learning_rate": 9.9716334910971e-06,
      "loss": 0.1175,
      "mae_dtheta": 0.008071537129580975,
      "mae_dx": 0.0018890445353463292,
      "mae_dy": 0.0014646853087469935,
      "pose_mae_dtheta": 0.05558621510863304,
      "pose_mae_dx": 0.020756542682647705,
      "pose_mae_dy": 0.017229096964001656,
      "pose_rmse_dtheta": 0.16101327538490295,
      "pose_rmse_dx": 0.053494893014431,
      "pose_rmse_dy": 0.04100354015827179,
      "pose_rmse_mean": 0.08517056703567505,
      "rmse_dtheta": 0.020574066787958145,
      "rmse_dx": 0.005926891230046749,
      "rmse_dy": 0.0037228460423648357,
      "rmse_mean": 0.01007460243999958,
      "rotation_flip": 0.003931203857064247,
      "sparse_tokens": 32121.0,
      "step": 524,
      "turn_loss": 0.057364147156476974,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.02439137706745958,
      "grad_norm": 1.3868966102600098,
      "learning_rate": 9.97149267380787e-06,
      "loss": 0.299,
      "mae_dtheta": 0.04247288778424263,
      "mae_dx": 0.01415308192372322,
      "mae_dy": 0.006154511123895645,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999992847442627,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 118.15064239501953,
      "model/head/act_norm_mean": 90.72985121783088,
      "model/head/act_norm_min": 60.28300857543945,
      "model/head/act_over_embed": 62.35040318314341,
      "model/head/grad_frac": 0.0939103439450264,
      "model/head/grad_norm": 0.09391027688980103,
      "model/head/grad_zero_frac": 0.0001700576685834676,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.68359375,
      "model/head/update_ratio": 0.001642595510929823,
      "model/head/weight_delta": 2.6032803058624268,
      "model/head/weight_delta_rel": 0.04566924646496773,
      "model/head/weight_norm": 57.17188262939453,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41018083691596985,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41018083691596985,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41018083691596985,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2818801113021526,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06554851680994034,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06554847210645676,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.54296875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0021388689056038857,
      "model/modality_embedder.encoders.pose/weight_delta": 0.7368118762969971,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.02407393977046013,
      "model/modality_embedder.encoders.pose/weight_norm": 30.646326065063477,
      "model/modality_embedder/grad_frac": 0.06554851680994034,
      "model/modality_embedder/grad_norm": 0.06554847210645676,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.54296875,
      "model/modality_embedder/update_ratio": 0.0021388689056038857,
      "model/modality_embedder/weight_delta": 0.7368118762969971,
      "model/modality_embedder/weight_delta_rel": 0.02407393977046013,
      "model/modality_embedder/weight_norm": 30.646326065063477,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 67.76652526855469,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.422471332282914,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.088885307312012,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.72172285988131,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08138168603181839,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.08138162642717361,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0029613554943352938,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.3541853427886963,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.012906727381050587,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.48120880126953,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 69.31365966796875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.334888903478056,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.80881118774414,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.348744756994499,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.068995401263237,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06899534910917282,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0023839804343879223,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.40757206082344055,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.014118614606559277,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.941240310668945,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 70.8881607055664,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 23.986158525910366,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.14764404296875,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.483512700959754,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07964831590652466,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07964825630187988,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002667341846972704,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.4126206934452057,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.01385503076016903,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.86053466796875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 71.27275848388672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.003736650910366,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.052563667297363,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 17.87001127732376,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07109305262565613,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07109300047159195,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002424910431727767,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.3434772491455078,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.011738422326743603,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.317785263061523,
      "model/normalizer/grad_frac": 0.2797396183013916,
      "model/normalizer/grad_norm": 0.2797394096851349,
      "model/normalizer/grad_zero_frac": 0.00014889903832226992,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003599081188440323,
      "model/normalizer/weight_delta": 0.7830337285995483,
      "model/normalizer/weight_delta_rel": 0.010085021145641804,
      "model/normalizer/weight_norm": 77.72522735595703,
      "pose_mae_dtheta": 0.3281266689300537,
      "pose_mae_dx": 0.12319517880678177,
      "pose_mae_dy": 0.07698500156402588,
      "pose_rmse_dtheta": 0.5415613651275635,
      "pose_rmse_dx": 0.25745752453804016,
      "pose_rmse_dy": 0.2027168720960617,
      "pose_rmse_mean": 0.3339118957519531,
      "rmse_dtheta": 0.05936272814869881,
      "rmse_dx": 0.02594883181154728,
      "rmse_dy": 0.012730361893773079,
      "rmse_mean": 0.03268064185976982,
      "rotation_flip": 0.005692599806934595,
      "sparse_tokens": 8502.0,
      "step": 525,
      "turn_loss": 0.41196027398109436,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.02443783683330236,
      "grad_norm": 0.6826530694961548,
      "learning_rate": 9.971351508859488e-06,
      "loss": 0.1627,
      "mae_dtheta": 0.011157703585922718,
      "mae_dx": 0.0024188850075006485,
      "mae_dy": 0.0024899414274841547,
      "pose_mae_dtheta": 0.08370765298604965,
      "pose_mae_dx": 0.030731845647096634,
      "pose_mae_dy": 0.030551716685295105,
      "pose_rmse_dtheta": 0.20638318359851837,
      "pose_rmse_dx": 0.07304655760526657,
      "pose_rmse_dy": 0.07073522359132767,
      "pose_rmse_mean": 0.11672165244817734,
      "rmse_dtheta": 0.023528719320893288,
      "rmse_dx": 0.006962375249713659,
      "rmse_dy": 0.005313543602824211,
      "rmse_mean": 0.01193487923592329,
      "rotation_flip": 0.0011432926403358579,
      "sparse_tokens": 32153.0,
      "step": 526,
      "turn_loss": 0.08396955579519272,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.02448429659914514,
      "grad_norm": 0.573051393032074,
      "learning_rate": 9.971209996261826e-06,
      "loss": 0.1623,
      "mae_dtheta": 0.01600859872996807,
      "mae_dx": 0.0032201155554503202,
      "mae_dy": 0.0028539018239825964,
      "pose_mae_dtheta": 0.11681859940290451,
      "pose_mae_dx": 0.04017797112464905,
      "pose_mae_dy": 0.04120582342147827,
      "pose_rmse_dtheta": 0.27024996280670166,
      "pose_rmse_dx": 0.0934114009141922,
      "pose_rmse_dy": 0.0955866128206253,
      "pose_rmse_mean": 0.15308265388011932,
      "rmse_dtheta": 0.03171101585030556,
      "rmse_dx": 0.009243466891348362,
      "rmse_dy": 0.005816258490085602,
      "rmse_mean": 0.015590246766805649,
      "rotation_flip": 0.002833864651620388,
      "sparse_tokens": 32137.0,
      "step": 527,
      "turn_loss": 0.13073252141475677,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.02453075636498792,
      "grad_norm": 0.5519191026687622,
      "learning_rate": 9.971068136024781e-06,
      "loss": 0.1386,
      "mae_dtheta": 0.015232665464282036,
      "mae_dx": 0.0031514710281044245,
      "mae_dy": 0.0048365481197834015,
      "pose_mae_dtheta": 0.10568108409643173,
      "pose_mae_dx": 0.042393773794174194,
      "pose_mae_dy": 0.04523056000471115,
      "pose_rmse_dtheta": 0.2270173728466034,
      "pose_rmse_dx": 0.1016053855419159,
      "pose_rmse_dy": 0.11058954149484634,
      "pose_rmse_mean": 0.14640410244464874,
      "rmse_dtheta": 0.029057439416646957,
      "rmse_dx": 0.008066768757998943,
      "rmse_dy": 0.009889994747936726,
      "rmse_mean": 0.01567140221595764,
      "rotation_flip": 0.006697215139865875,
      "sparse_tokens": 32105.0,
      "step": 528,
      "turn_loss": 0.15698009729385376,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.0245772161308307,
      "grad_norm": 0.4662819504737854,
      "learning_rate": 9.970925928158275e-06,
      "loss": 0.126,
      "mae_dtheta": 0.010827475227415562,
      "mae_dx": 0.0034698050003498793,
      "mae_dy": 0.0015847054310142994,
      "pose_mae_dtheta": 0.08720208704471588,
      "pose_mae_dx": 0.03499728813767433,
      "pose_mae_dy": 0.02704223245382309,
      "pose_rmse_dtheta": 0.25450006127357483,
      "pose_rmse_dx": 0.11855296045541763,
      "pose_rmse_dy": 0.07250043749809265,
      "pose_rmse_mean": 0.14851781725883484,
      "rmse_dtheta": 0.028741685673594475,
      "rmse_dx": 0.011791392229497433,
      "rmse_dy": 0.004248441196978092,
      "rmse_mean": 0.014927173033356667,
      "rotation_flip": 0.004123711492866278,
      "sparse_tokens": 32073.0,
      "step": 529,
      "turn_loss": 0.09450417011976242,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.02462367589667348,
      "grad_norm": 0.6231260299682617,
      "learning_rate": 9.970783372672248e-06,
      "loss": 0.1785,
      "mae_dtheta": 0.022664738819003105,
      "mae_dx": 0.0033563636243343353,
      "mae_dy": 0.005809072870761156,
      "pose_mae_dtheta": 0.1655195653438568,
      "pose_mae_dx": 0.0553913377225399,
      "pose_mae_dy": 0.07526815682649612,
      "pose_rmse_dtheta": 0.3127427399158478,
      "pose_rmse_dx": 0.11961934715509415,
      "pose_rmse_dy": 0.18806642293930054,
      "pose_rmse_mean": 0.20680950582027435,
      "rmse_dtheta": 0.03645877540111542,
      "rmse_dx": 0.008255304768681526,
      "rmse_dy": 0.011489844880998135,
      "rmse_mean": 0.0187346413731575,
      "rotation_flip": 0.01023171842098236,
      "sparse_tokens": 32073.0,
      "step": 530,
      "turn_loss": 0.1925642192363739,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6176.0,
      "epoch": 0.02467013566251626,
      "grad_norm": 0.6901862621307373,
      "learning_rate": 9.970640469576674e-06,
      "loss": 0.1491,
      "mae_dtheta": 0.03411918133497238,
      "mae_dx": 0.010282385163009167,
      "mae_dy": 0.005915094166994095,
      "pose_mae_dtheta": 0.26480695605278015,
      "pose_mae_dx": 0.08453916758298874,
      "pose_mae_dy": 0.07719239592552185,
      "pose_rmse_dtheta": 0.40461042523384094,
      "pose_rmse_dx": 0.21216188371181488,
      "pose_rmse_dy": 0.15511298179626465,
      "pose_rmse_mean": 0.2572951018810272,
      "rmse_dtheta": 0.04648851975798607,
      "rmse_dx": 0.022742753848433495,
      "rmse_dy": 0.010043182410299778,
      "rmse_mean": 0.026424817740917206,
      "rotation_flip": 0.014035088010132313,
      "sparse_tokens": 5323.0,
      "step": 531,
      "turn_loss": 0.3062093257904053,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 28140.0,
      "epoch": 0.02471659542835904,
      "grad_norm": 0.7588047981262207,
      "learning_rate": 9.970497218881542e-06,
      "loss": 0.2376,
      "mae_dtheta": 0.024678200483322144,
      "mae_dx": 0.011710146442055702,
      "mae_dy": 0.004995009861886501,
      "pose_mae_dtheta": 0.18482311069965363,
      "pose_mae_dx": 0.10812963545322418,
      "pose_mae_dy": 0.06706598401069641,
      "pose_rmse_dtheta": 0.3321166932582855,
      "pose_rmse_dx": 0.26477375626564026,
      "pose_rmse_dy": 0.14956623315811157,
      "pose_rmse_mean": 0.24881890416145325,
      "rmse_dtheta": 0.03866330534219742,
      "rmse_dx": 0.026042558252811432,
      "rmse_dy": 0.009659340605139732,
      "rmse_mean": 0.024788402020931244,
      "rotation_flip": 0.0077444338239729404,
      "sparse_tokens": 22532.0,
      "step": 532,
      "turn_loss": 0.2583346664905548,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.02476305519420182,
      "grad_norm": 0.5071451663970947,
      "learning_rate": 9.970353620596873e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.01211621519178152,
      "mae_dx": 0.0035691934172064066,
      "mae_dy": 0.002005770104005933,
      "pose_mae_dtheta": 0.09080223739147186,
      "pose_mae_dx": 0.035337161272764206,
      "pose_mae_dy": 0.030135292559862137,
      "pose_rmse_dtheta": 0.237869530916214,
      "pose_rmse_dx": 0.11690665036439896,
      "pose_rmse_dy": 0.07160511612892151,
      "pose_rmse_mean": 0.14212709665298462,
      "rmse_dtheta": 0.026840146631002426,
      "rmse_dx": 0.01175313163548708,
      "rmse_dy": 0.004041499458253384,
      "rmse_mean": 0.014211593195796013,
      "rotation_flip": 0.0037837838754057884,
      "sparse_tokens": 32073.0,
      "step": 533,
      "turn_loss": 0.08128704875707626,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0248095149600446,
      "grad_norm": 0.5361594557762146,
      "learning_rate": 9.970209674732706e-06,
      "loss": 0.1839,
      "mae_dtheta": 0.013207820244133472,
      "mae_dx": 0.0024686360266059637,
      "mae_dy": 0.0031291740015149117,
      "pose_mae_dtheta": 0.10059746354818344,
      "pose_mae_dx": 0.032836757600307465,
      "pose_mae_dy": 0.04090043529868126,
      "pose_rmse_dtheta": 0.2003316730260849,
      "pose_rmse_dx": 0.07945651561021805,
      "pose_rmse_dy": 0.09082593023777008,
      "pose_rmse_mean": 0.12353803962469101,
      "rmse_dtheta": 0.025675075128674507,
      "rmse_dx": 0.006865710485726595,
      "rmse_dy": 0.006400709506124258,
      "rmse_mean": 0.012980498373508453,
      "rotation_flip": 0.007984790951013565,
      "sparse_tokens": 32089.0,
      "step": 534,
      "turn_loss": 0.09992312639951706,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.02485597472588738,
      "grad_norm": 0.6992639899253845,
      "learning_rate": 9.970065381299112e-06,
      "loss": 0.138,
      "mae_dtheta": 0.011713034473359585,
      "mae_dx": 0.0024755981285125017,
      "mae_dy": 0.002176369074732065,
      "pose_mae_dtheta": 0.07936698943376541,
      "pose_mae_dx": 0.027471080422401428,
      "pose_mae_dy": 0.02786918357014656,
      "pose_rmse_dtheta": 0.20481367409229279,
      "pose_rmse_dx": 0.06744126230478287,
      "pose_rmse_dy": 0.061006098985672,
      "pose_rmse_mean": 0.11108701676130295,
      "rmse_dtheta": 0.0255381241440773,
      "rmse_dx": 0.007907182909548283,
      "rmse_dy": 0.004744012374430895,
      "rmse_mean": 0.012729773297905922,
      "rotation_flip": 0.00272479560226202,
      "sparse_tokens": 32089.0,
      "step": 535,
      "turn_loss": 0.08035089075565338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.02490243449173016,
      "grad_norm": 0.5016449689865112,
      "learning_rate": 9.969920740306176e-06,
      "loss": 0.1234,
      "mae_dtheta": 0.025459252297878265,
      "mae_dx": 0.015673933550715446,
      "mae_dy": 0.001935571781359613,
      "pose_mae_dtheta": 0.1704341620206833,
      "pose_mae_dx": 0.11133445799350739,
      "pose_mae_dy": 0.013919535093009472,
      "pose_rmse_dtheta": 0.35597947239875793,
      "pose_rmse_dx": 0.25081443786621094,
      "pose_rmse_dy": 0.028794001787900925,
      "pose_rmse_mean": 0.21186262369155884,
      "rmse_dtheta": 0.0438736155629158,
      "rmse_dx": 0.029598329216241837,
      "rmse_dy": 0.0054461415857076645,
      "rmse_mean": 0.0263060312718153,
      "rotation_flip": 0.010362694039940834,
      "sparse_tokens": 8737.0,
      "step": 536,
      "turn_loss": 0.21112531423568726,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 31790.0,
      "epoch": 0.02494889425757294,
      "grad_norm": 0.6795143485069275,
      "learning_rate": 9.969775751764015e-06,
      "loss": 0.2674,
      "mae_dtheta": 0.021755093708634377,
      "mae_dx": 0.0074190981686115265,
      "mae_dy": 0.002986498409882188,
      "pose_mae_dtheta": 0.16694192588329315,
      "pose_mae_dx": 0.05796743556857109,
      "pose_mae_dy": 0.03635001927614212,
      "pose_rmse_dtheta": 0.3397407829761505,
      "pose_rmse_dx": 0.14738334715366364,
      "pose_rmse_dy": 0.1030895859003067,
      "pose_rmse_mean": 0.19673791527748108,
      "rmse_dtheta": 0.039796214550733566,
      "rmse_dx": 0.0176592655479908,
      "rmse_dy": 0.006829539779573679,
      "rmse_mean": 0.021428339183330536,
      "rotation_flip": 0.005464480724185705,
      "sparse_tokens": 25152.0,
      "step": 537,
      "turn_loss": 0.18869319558143616,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.02499535402341572,
      "grad_norm": 0.4296514689922333,
      "learning_rate": 9.96963041568277e-06,
      "loss": 0.1602,
      "mae_dtheta": 0.018881624564528465,
      "mae_dx": 0.004672665148973465,
      "mae_dy": 0.006261741742491722,
      "pose_mae_dtheta": 0.14016972482204437,
      "pose_mae_dx": 0.04768098145723343,
      "pose_mae_dy": 0.058028239756822586,
      "pose_rmse_dtheta": 0.30643320083618164,
      "pose_rmse_dx": 0.10608049482107162,
      "pose_rmse_dy": 0.13673138618469238,
      "pose_rmse_mean": 0.183081716299057,
      "rmse_dtheta": 0.035646528005599976,
      "rmse_dx": 0.011969328857958317,
      "rmse_dy": 0.014615025371313095,
      "rmse_mean": 0.020743627101182938,
      "rotation_flip": 0.00820448063313961,
      "sparse_tokens": 32137.0,
      "step": 538,
      "turn_loss": 0.20213502645492554,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.025041813789258502,
      "grad_norm": 0.6642872095108032,
      "learning_rate": 9.9694847320726e-06,
      "loss": 0.169,
      "mae_dtheta": 0.026460591703653336,
      "mae_dx": 0.008871711790561676,
      "mae_dy": 0.004610620439052582,
      "pose_mae_dtheta": 0.20951952040195465,
      "pose_mae_dx": 0.08414062857627869,
      "pose_mae_dy": 0.06187225505709648,
      "pose_rmse_dtheta": 0.3826166093349457,
      "pose_rmse_dx": 0.18820755183696747,
      "pose_rmse_dy": 0.16305731236934662,
      "pose_rmse_mean": 0.24462716281414032,
      "rmse_dtheta": 0.04259953275322914,
      "rmse_dx": 0.01971895433962345,
      "rmse_dy": 0.009658971801400185,
      "rmse_mean": 0.02399248629808426,
      "rotation_flip": 0.009999999776482582,
      "sparse_tokens": 18123.0,
      "step": 539,
      "turn_loss": 0.21831639111042023,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.025088273555101282,
      "grad_norm": 0.6697903871536255,
      "learning_rate": 9.969338700943698e-06,
      "loss": 0.1686,
      "mae_dtheta": 0.02690723165869713,
      "mae_dx": 0.0029429488349705935,
      "mae_dy": 0.0023366159293800592,
      "pose_mae_dtheta": 0.23905260860919952,
      "pose_mae_dx": 0.03519503399729729,
      "pose_mae_dy": 0.04145970195531845,
      "pose_rmse_dtheta": 0.5211763381958008,
      "pose_rmse_dx": 0.07288707047700882,
      "pose_rmse_dy": 0.11759889125823975,
      "pose_rmse_mean": 0.23722076416015625,
      "rmse_dtheta": 0.0490974597632885,
      "rmse_dx": 0.0059085506945848465,
      "rmse_dy": 0.004323531873524189,
      "rmse_mean": 0.019776515662670135,
      "rotation_flip": 0.0,
      "sparse_tokens": 2867.0,
      "step": 540,
      "turn_loss": 0.20046129822731018,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.025134733320944062,
      "grad_norm": 0.4357529878616333,
      "learning_rate": 9.969192322306271e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.017290960997343063,
      "mae_dx": 0.005650066304951906,
      "mae_dy": 0.005714669823646545,
      "pose_mae_dtheta": 0.13503332436084747,
      "pose_mae_dx": 0.06489145010709763,
      "pose_mae_dy": 0.0652906596660614,
      "pose_rmse_dtheta": 0.28116893768310547,
      "pose_rmse_dx": 0.14742232859134674,
      "pose_rmse_dy": 0.1557106226682663,
      "pose_rmse_mean": 0.1947672963142395,
      "rmse_dtheta": 0.031911253929138184,
      "rmse_dx": 0.014297222718596458,
      "rmse_dy": 0.012074509635567665,
      "rmse_mean": 0.01942766271531582,
      "rotation_flip": 0.009931506589055061,
      "sparse_tokens": 32105.0,
      "step": 541,
      "turn_loss": 0.17031531035900116,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.025181193086786843,
      "grad_norm": 1.291131615638733,
      "learning_rate": 9.969045596170559e-06,
      "loss": 0.3375,
      "mae_dtheta": 0.028238428756594658,
      "mae_dx": 0.012686781585216522,
      "mae_dy": 0.005089390557259321,
      "pose_mae_dtheta": 0.22953341901302338,
      "pose_mae_dx": 0.06938733160495758,
      "pose_mae_dy": 0.0689539909362793,
      "pose_rmse_dtheta": 0.4416646659374237,
      "pose_rmse_dx": 0.14612500369548798,
      "pose_rmse_dy": 0.16640938818454742,
      "pose_rmse_mean": 0.2513996958732605,
      "rmse_dtheta": 0.04516514018177986,
      "rmse_dx": 0.02464647963643074,
      "rmse_dy": 0.00912909023463726,
      "rmse_mean": 0.026313571259379387,
      "rotation_flip": 0.016161616891622543,
      "sparse_tokens": 7669.0,
      "step": 542,
      "turn_loss": 0.25275754928588867,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.025227652852629623,
      "grad_norm": 0.6117337346076965,
      "learning_rate": 9.968898522546822e-06,
      "loss": 0.1603,
      "mae_dtheta": 0.012624865397810936,
      "mae_dx": 0.0026475524064153433,
      "mae_dy": 0.002796945860609412,
      "pose_mae_dtheta": 0.08562690019607544,
      "pose_mae_dx": 0.03323763981461525,
      "pose_mae_dy": 0.03679967299103737,
      "pose_rmse_dtheta": 0.20318277180194855,
      "pose_rmse_dx": 0.08337581157684326,
      "pose_rmse_dy": 0.08504067361354828,
      "pose_rmse_mean": 0.12386642396450043,
      "rmse_dtheta": 0.026660265401005745,
      "rmse_dx": 0.0075723109766840935,
      "rmse_dy": 0.005608288571238518,
      "rmse_mean": 0.013280287384986877,
      "rotation_flip": 0.008490930311381817,
      "sparse_tokens": 32105.0,
      "step": 543,
      "turn_loss": 0.09719129651784897,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.025274112618472403,
      "grad_norm": 0.6897807121276855,
      "learning_rate": 9.968751101445344e-06,
      "loss": 0.1675,
      "mae_dtheta": 0.02074175328016281,
      "mae_dx": 0.002758410992100835,
      "mae_dy": 0.005252709612250328,
      "pose_mae_dtheta": 0.1411597579717636,
      "pose_mae_dx": 0.04926363378763199,
      "pose_mae_dy": 0.06387436389923096,
      "pose_rmse_dtheta": 0.2689445912837982,
      "pose_rmse_dx": 0.10211113095283508,
      "pose_rmse_dy": 0.13122138381004333,
      "pose_rmse_mean": 0.1674257218837738,
      "rmse_dtheta": 0.03452388197183609,
      "rmse_dx": 0.006973761599510908,
      "rmse_dy": 0.008529305458068848,
      "rmse_mean": 0.01667565107345581,
      "rotation_flip": 0.00933125987648964,
      "sparse_tokens": 32089.0,
      "step": 544,
      "turn_loss": 0.1791410893201828,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.025320572384315183,
      "grad_norm": 0.5354726314544678,
      "learning_rate": 9.968603332876435e-06,
      "loss": 0.0888,
      "mae_dtheta": 0.00729792844504118,
      "mae_dx": 0.0018155615543946624,
      "mae_dy": 0.0011773244477808475,
      "pose_mae_dtheta": 0.05755351856350899,
      "pose_mae_dx": 0.01650860160589218,
      "pose_mae_dy": 0.01658015511929989,
      "pose_rmse_dtheta": 0.1981271356344223,
      "pose_rmse_dx": 0.052919261157512665,
      "pose_rmse_dy": 0.05083584040403366,
      "pose_rmse_mean": 0.10062741488218307,
      "rmse_dtheta": 0.021524135023355484,
      "rmse_dx": 0.006187646649777889,
      "rmse_dy": 0.003406379371881485,
      "rmse_mean": 0.010372720658779144,
      "rotation_flip": 0.0008183306199498475,
      "sparse_tokens": 32057.0,
      "step": 545,
      "turn_loss": 0.049238018691539764,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.025367032150157964,
      "grad_norm": 0.4515390992164612,
      "learning_rate": 9.968455216850426e-06,
      "loss": 0.0843,
      "mae_dtheta": 0.04031055420637131,
      "mae_dx": 0.009036414325237274,
      "mae_dy": 0.004673187620937824,
      "pose_mae_dtheta": 0.3012019693851471,
      "pose_mae_dx": 0.06590893864631653,
      "pose_mae_dy": 0.04482363536953926,
      "pose_rmse_dtheta": 0.5574743747711182,
      "pose_rmse_dx": 0.17812137305736542,
      "pose_rmse_dy": 0.11378471553325653,
      "pose_rmse_mean": 0.2831268310546875,
      "rmse_dtheta": 0.060867901891469955,
      "rmse_dx": 0.020375164225697517,
      "rmse_dy": 0.011210625991225243,
      "rmse_mean": 0.030817899852991104,
      "rotation_flip": 0.019886363297700882,
      "sparse_tokens": 7056.0,
      "step": 546,
      "turn_loss": 0.19947081804275513,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.025413491916000744,
      "grad_norm": 0.5078949332237244,
      "learning_rate": 9.968306753377679e-06,
      "loss": 0.1383,
      "mae_dtheta": 0.015305889770388603,
      "mae_dx": 0.003235001116991043,
      "mae_dy": 0.004749041981995106,
      "pose_mae_dtheta": 0.11020039021968842,
      "pose_mae_dx": 0.03985264152288437,
      "pose_mae_dy": 0.041872620582580566,
      "pose_rmse_dtheta": 0.25668004155158997,
      "pose_rmse_dx": 0.09740619361400604,
      "pose_rmse_dy": 0.08994258940219879,
      "pose_rmse_mean": 0.14800959825515747,
      "rmse_dtheta": 0.0312128197401762,
      "rmse_dx": 0.008685320615768433,
      "rmse_dy": 0.010426735505461693,
      "rmse_mean": 0.016774959862232208,
      "rotation_flip": 0.004686834290623665,
      "sparse_tokens": 32057.0,
      "step": 547,
      "turn_loss": 0.12690164148807526,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.025459951681843524,
      "grad_norm": 0.5267012119293213,
      "learning_rate": 9.968157942468573e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.046474479138851166,
      "mae_dx": 0.011706406250596046,
      "mae_dy": 0.004292009398341179,
      "pose_mae_dtheta": 0.38510239124298096,
      "pose_mae_dx": 0.11382867395877838,
      "pose_mae_dy": 0.06317239999771118,
      "pose_rmse_dtheta": 0.6754741072654724,
      "pose_rmse_dx": 0.2449847310781479,
      "pose_rmse_dy": 0.14384908974170685,
      "pose_rmse_mean": 0.3547693192958832,
      "rmse_dtheta": 0.06944140046834946,
      "rmse_dx": 0.024139881134033203,
      "rmse_dy": 0.01058263424783945,
      "rmse_mean": 0.03472130745649338,
      "rotation_flip": 0.017825311049818993,
      "sparse_tokens": 9252.0,
      "step": 548,
      "turn_loss": 0.3122958540916443,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.025506411447686304,
      "grad_norm": 0.692831814289093,
      "learning_rate": 9.968008784133516e-06,
      "loss": 0.1631,
      "mae_dtheta": 0.01427006907761097,
      "mae_dx": 0.0022857943549752235,
      "mae_dy": 0.002638059202581644,
      "pose_mae_dtheta": 0.10074904561042786,
      "pose_mae_dx": 0.028970610350370407,
      "pose_mae_dy": 0.03652083873748779,
      "pose_rmse_dtheta": 0.2337547242641449,
      "pose_rmse_dx": 0.08024872094392776,
      "pose_rmse_dy": 0.08394943922758102,
      "pose_rmse_mean": 0.1326509714126587,
      "rmse_dtheta": 0.028256487101316452,
      "rmse_dx": 0.008092707954347134,
      "rmse_dy": 0.005564149469137192,
      "rmse_mean": 0.013971115462481976,
      "rotation_flip": 0.004093784838914871,
      "sparse_tokens": 32089.0,
      "step": 549,
      "turn_loss": 0.10209539532661438,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.025552871213529085,
      "grad_norm": 0.4202897548675537,
      "learning_rate": 9.967859278382939e-06,
      "loss": 0.101,
      "mae_dtheta": 0.0420912429690361,
      "mae_dx": 0.013164317235350609,
      "mae_dy": 0.0048066177405416965,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4202897846698761,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 123.45307159423828,
      "model/head/act_norm_mean": 96.85215849034927,
      "model/head/act_norm_min": 67.72643280029297,
      "model/head/act_over_embed": 66.55771005876178,
      "model/head/grad_frac": 0.13082687556743622,
      "model/head/grad_norm": 0.05498519912362099,
      "model/head/grad_zero_frac": 0.0001687885815044865,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6898552389705882,
      "model/head/update_ratio": 0.0009616129682399333,
      "model/head/weight_delta": 2.653270959854126,
      "model/head/weight_delta_rel": 0.04654623195528984,
      "model/head/weight_norm": 57.18017578125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41030287742614746,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41030287742614746,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41030287742614746,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2819639786833079,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07973837852478027,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03351322561502457,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.54296875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010934529127553105,
      "model/modality_embedder.encoders.pose/weight_delta": 0.7537882924079895,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.024628613144159317,
      "model/modality_embedder.encoders.pose/weight_norm": 30.64898681640625,
      "model/modality_embedder/grad_frac": 0.07973837852478027,
      "model/modality_embedder/grad_norm": 0.03351322561502457,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.54296875,
      "model/modality_embedder/update_ratio": 0.0010934529127553105,
      "model/modality_embedder/weight_delta": 0.7537882924079895,
      "model/modality_embedder/weight_delta_rel": 0.024628613144159317,
      "model/modality_embedder/weight_norm": 30.64898681640625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 69.60916137695312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.992670766223156,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.216728210449219,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.113569249176253,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10765252262353897,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04524525627493858,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016462987987324595,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.3637794554233551,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.013256343081593513,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.483016967773438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 71.06544494628906,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.927634074463118,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.830482482910156,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.756084787863156,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10945023596286774,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04600081592798233,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015892252558842301,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.4224085509777069,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.014632562175393105,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.9454345703125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 72.67084503173828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.641292454481793,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.080719947814941,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.933726870134514,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11133979260921478,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04679497703909874,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015669196145609021,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.42850932478904724,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.014388540759682655,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.86431312561035,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 72.95117950439453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.65705240429505,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.982880592346191,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.318975979488165,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12753844261169434,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05360310524702072,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018281510565429926,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.35744085907936096,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.012215632013976574,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.320938110351562,
      "model/normalizer/grad_frac": 0.45707499980926514,
      "model/normalizer/grad_norm": 0.19210395216941833,
      "model/normalizer/grad_zero_frac": 0.00015362599515356123,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0024714330211281776,
      "model/normalizer/weight_delta": 0.8111535906791687,
      "model/normalizer/weight_delta_rel": 0.010447188280522823,
      "model/normalizer/weight_norm": 77.72978210449219,
      "pose_mae_dtheta": 0.3727986514568329,
      "pose_mae_dx": 0.10412949323654175,
      "pose_mae_dy": 0.060129765421152115,
      "pose_rmse_dtheta": 0.6204198598861694,
      "pose_rmse_dx": 0.22425633668899536,
      "pose_rmse_dy": 0.1364983320236206,
      "pose_rmse_mean": 0.32705819606781006,
      "rmse_dtheta": 0.06077831983566284,
      "rmse_dx": 0.02641977183520794,
      "rmse_dy": 0.010415318422019482,
      "rmse_mean": 0.032537803053855896,
      "rotation_flip": 0.008510638028383255,
      "sparse_tokens": 8787.0,
      "step": 550,
      "turn_loss": 0.26004672050476074,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.025599330979371865,
      "grad_norm": 0.7729699015617371,
      "learning_rate": 9.967709425227295e-06,
      "loss": 0.1771,
      "mae_dtheta": 0.016049131751060486,
      "mae_dx": 0.00332838692702353,
      "mae_dy": 0.00449738185852766,
      "pose_mae_dtheta": 0.12208188325166702,
      "pose_mae_dx": 0.04056647792458534,
      "pose_mae_dy": 0.046443209052085876,
      "pose_rmse_dtheta": 0.2929706275463104,
      "pose_rmse_dx": 0.11689449846744537,
      "pose_rmse_dy": 0.12014036625623703,
      "pose_rmse_mean": 0.17666850984096527,
      "rmse_dtheta": 0.03339530527591705,
      "rmse_dx": 0.008563061244785786,
      "rmse_dy": 0.012208082713186741,
      "rmse_mean": 0.01805548369884491,
      "rotation_flip": 0.006533279083669186,
      "sparse_tokens": 32105.0,
      "step": 551,
      "turn_loss": 0.14144623279571533,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35254.0,
      "epoch": 0.025645790745214645,
      "grad_norm": 0.4141135513782501,
      "learning_rate": 9.967559224677065e-06,
      "loss": 0.1628,
      "mae_dtheta": 0.04075608775019646,
      "mae_dx": 0.012948673218488693,
      "mae_dy": 0.005477351136505604,
      "pose_mae_dtheta": 0.35321229696273804,
      "pose_mae_dx": 0.10971364378929138,
      "pose_mae_dy": 0.07579530775547028,
      "pose_rmse_dtheta": 0.5774784684181213,
      "pose_rmse_dx": 0.250011682510376,
      "pose_rmse_dy": 0.1606055200099945,
      "pose_rmse_mean": 0.32936522364616394,
      "rmse_dtheta": 0.05822480097413063,
      "rmse_dx": 0.026043474674224854,
      "rmse_dy": 0.00991961918771267,
      "rmse_mean": 0.031395964324474335,
      "rotation_flip": 0.010455104522407055,
      "sparse_tokens": 29554.0,
      "step": 552,
      "turn_loss": 0.29614534974098206,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 30077.0,
      "epoch": 0.025692250511057425,
      "grad_norm": 0.5201734304428101,
      "learning_rate": 9.96740867674275e-06,
      "loss": 0.1555,
      "mae_dtheta": 0.04379427060484886,
      "mae_dx": 0.016265658661723137,
      "mae_dy": 0.007115613203495741,
      "pose_mae_dtheta": 0.34621381759643555,
      "pose_mae_dx": 0.13107873499393463,
      "pose_mae_dy": 0.08795765787363052,
      "pose_rmse_dtheta": 0.5618669986724854,
      "pose_rmse_dx": 0.27347978949546814,
      "pose_rmse_dy": 0.2099350541830063,
      "pose_rmse_mean": 0.34842729568481445,
      "rmse_dtheta": 0.06156602501869202,
      "rmse_dx": 0.0290359016507864,
      "rmse_dy": 0.016014516353607178,
      "rmse_mean": 0.03553881496191025,
      "rotation_flip": 0.01832844503223896,
      "sparse_tokens": 24424.0,
      "step": 553,
      "turn_loss": 0.3802509903907776,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.025738710276900206,
      "grad_norm": 0.5887050032615662,
      "learning_rate": 9.967257781434885e-06,
      "loss": 0.1655,
      "mae_dtheta": 0.03229990229010582,
      "mae_dx": 0.012743539176881313,
      "mae_dy": 0.006462130229920149,
      "pose_mae_dtheta": 0.2527962028980255,
      "pose_mae_dx": 0.09896082431077957,
      "pose_mae_dy": 0.09274391829967499,
      "pose_rmse_dtheta": 0.40993988513946533,
      "pose_rmse_dx": 0.2284250259399414,
      "pose_rmse_dy": 0.2041119933128357,
      "pose_rmse_mean": 0.2808256447315216,
      "rmse_dtheta": 0.04905728995800018,
      "rmse_dx": 0.026037447154521942,
      "rmse_dy": 0.011942517943680286,
      "rmse_mean": 0.029012419283390045,
      "rotation_flip": 0.014820592477917671,
      "sparse_tokens": 22121.0,
      "step": 554,
      "turn_loss": 0.2887645363807678,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.025785170042742986,
      "grad_norm": 0.5511578917503357,
      "learning_rate": 9.967106538764013e-06,
      "loss": 0.1649,
      "mae_dtheta": 0.04380502179265022,
      "mae_dx": 0.012935304082930088,
      "mae_dy": 0.00878603383898735,
      "pose_mae_dtheta": 0.34556442499160767,
      "pose_mae_dx": 0.114716537296772,
      "pose_mae_dy": 0.09341615438461304,
      "pose_rmse_dtheta": 0.5585484504699707,
      "pose_rmse_dx": 0.23589453101158142,
      "pose_rmse_dy": 0.18271824717521667,
      "pose_rmse_mean": 0.3257204294204712,
      "rmse_dtheta": 0.06038380041718483,
      "rmse_dx": 0.024325555190443993,
      "rmse_dy": 0.015032153576612473,
      "rmse_mean": 0.033247169107198715,
      "rotation_flip": 0.018972331658005714,
      "sparse_tokens": 21856.0,
      "step": 555,
      "turn_loss": 0.3984026610851288,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.025831629808585766,
      "grad_norm": 0.6305825710296631,
      "learning_rate": 9.966954948740717e-06,
      "loss": 0.1913,
      "mae_dtheta": 0.037408873438835144,
      "mae_dx": 0.012169293127954006,
      "mae_dy": 0.004178549628704786,
      "pose_mae_dtheta": 0.3004586398601532,
      "pose_mae_dx": 0.09835083037614822,
      "pose_mae_dy": 0.052416399121284485,
      "pose_rmse_dtheta": 0.5269715189933777,
      "pose_rmse_dx": 0.22808639705181122,
      "pose_rmse_dy": 0.10996107012033463,
      "pose_rmse_mean": 0.28833967447280884,
      "rmse_dtheta": 0.05552929267287254,
      "rmse_dx": 0.024884557351469994,
      "rmse_dy": 0.007525050546973944,
      "rmse_mean": 0.029312966391444206,
      "rotation_flip": 0.01104972418397665,
      "sparse_tokens": 16684.0,
      "step": 556,
      "turn_loss": 0.2415669858455658,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.025878089574428546,
      "grad_norm": 0.7529296875,
      "learning_rate": 9.966803011375594e-06,
      "loss": 0.2829,
      "mae_dtheta": 0.026668453589081764,
      "mae_dx": 0.013224282301962376,
      "mae_dy": 0.004517785273492336,
      "pose_mae_dtheta": 0.217627614736557,
      "pose_mae_dx": 0.09989689290523529,
      "pose_mae_dy": 0.05444765090942383,
      "pose_rmse_dtheta": 0.36745694279670715,
      "pose_rmse_dx": 0.23052938282489777,
      "pose_rmse_dy": 0.14393121004104614,
      "pose_rmse_mean": 0.24730585515499115,
      "rmse_dtheta": 0.042075127363204956,
      "rmse_dx": 0.025831107050180435,
      "rmse_dy": 0.009287277236580849,
      "rmse_mean": 0.025731168687343597,
      "rotation_flip": 0.010288066230714321,
      "sparse_tokens": 9058.0,
      "step": 557,
      "turn_loss": 0.23255068063735962,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.025924549340271327,
      "grad_norm": 0.6625281572341919,
      "learning_rate": 9.966650726679273e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.01144995354115963,
      "mae_dx": 0.0026157309766858816,
      "mae_dy": 0.002938138088211417,
      "pose_mae_dtheta": 0.08942048251628876,
      "pose_mae_dx": 0.03254901245236397,
      "pose_mae_dy": 0.03471282124519348,
      "pose_rmse_dtheta": 0.21997065842151642,
      "pose_rmse_dx": 0.0847293809056282,
      "pose_rmse_dy": 0.0859261155128479,
      "pose_rmse_mean": 0.13020873069763184,
      "rmse_dtheta": 0.02591118775308132,
      "rmse_dx": 0.007612811401486397,
      "rmse_dy": 0.007494810037314892,
      "rmse_mean": 0.013672936707735062,
      "rotation_flip": 0.0047904192470014095,
      "sparse_tokens": 32121.0,
      "step": 558,
      "turn_loss": 0.09420523047447205,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.025971009106114107,
      "grad_norm": 0.5187568068504333,
      "learning_rate": 9.966498094662398e-06,
      "loss": 0.1182,
      "mae_dtheta": 0.009189615026116371,
      "mae_dx": 0.0022880304604768753,
      "mae_dy": 0.0015347304288297892,
      "pose_mae_dtheta": 0.07373373210430145,
      "pose_mae_dx": 0.026896882802248,
      "pose_mae_dy": 0.022048890590667725,
      "pose_rmse_dtheta": 0.2266213744878769,
      "pose_rmse_dx": 0.06995988637208939,
      "pose_rmse_dy": 0.0631062462925911,
      "pose_rmse_mean": 0.11989583820104599,
      "rmse_dtheta": 0.025860590860247612,
      "rmse_dx": 0.006144117563962936,
      "rmse_dy": 0.00448149349540472,
      "rmse_mean": 0.012162066996097565,
      "rotation_flip": 0.0042060986161231995,
      "sparse_tokens": 32169.0,
      "step": 559,
      "turn_loss": 0.06816229969263077,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4577.0,
      "epoch": 0.026017468871956884,
      "grad_norm": 0.4968968629837036,
      "learning_rate": 9.966345115335648e-06,
      "loss": 0.1495,
      "mae_dtheta": 0.02826032042503357,
      "mae_dx": 0.0073324465192854404,
      "mae_dy": 0.004961945582181215,
      "pose_mae_dtheta": 0.23572517931461334,
      "pose_mae_dx": 0.05111604183912277,
      "pose_mae_dy": 0.03212728351354599,
      "pose_rmse_dtheta": 0.45684534311294556,
      "pose_rmse_dx": 0.12013254314661026,
      "pose_rmse_dy": 0.07346004247665405,
      "pose_rmse_mean": 0.21681265532970428,
      "rmse_dtheta": 0.04650966823101044,
      "rmse_dx": 0.015638601034879684,
      "rmse_dy": 0.012735983356833458,
      "rmse_mean": 0.02496141754090786,
      "rotation_flip": 0.017777778208255768,
      "sparse_tokens": 3588.0,
      "step": 560,
      "turn_loss": 0.20348916947841644,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.026063928637799664,
      "grad_norm": 0.5370217561721802,
      "learning_rate": 9.966191788709716e-06,
      "loss": 0.1388,
      "mae_dtheta": 0.03347292169928551,
      "mae_dx": 0.0150979058817029,
      "mae_dy": 0.005129432771354914,
      "pose_mae_dtheta": 0.2711339294910431,
      "pose_mae_dx": 0.1171506941318512,
      "pose_mae_dy": 0.06559247523546219,
      "pose_rmse_dtheta": 0.4666208028793335,
      "pose_rmse_dx": 0.2458719164133072,
      "pose_rmse_dy": 0.1471516638994217,
      "pose_rmse_mean": 0.2865481376647949,
      "rmse_dtheta": 0.049202919006347656,
      "rmse_dx": 0.02842092700302601,
      "rmse_dy": 0.008640456013381481,
      "rmse_mean": 0.028754767030477524,
      "rotation_flip": 0.015625,
      "sparse_tokens": 15231.0,
      "step": 561,
      "turn_loss": 0.28016480803489685,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.026110388403642444,
      "grad_norm": 0.5284826159477234,
      "learning_rate": 9.966038114795327e-06,
      "loss": 0.1379,
      "mae_dtheta": 0.012924905866384506,
      "mae_dx": 0.002337478566914797,
      "mae_dy": 0.002728660125285387,
      "pose_mae_dtheta": 0.08812976628541946,
      "pose_mae_dx": 0.02737223543226719,
      "pose_mae_dy": 0.037105120718479156,
      "pose_rmse_dtheta": 0.20892789959907532,
      "pose_rmse_dx": 0.07342154532670975,
      "pose_rmse_dy": 0.08359794318675995,
      "pose_rmse_mean": 0.12198245525360107,
      "rmse_dtheta": 0.02658861316740513,
      "rmse_dx": 0.007248591165989637,
      "rmse_dy": 0.006073551718145609,
      "rmse_mean": 0.013303585350513458,
      "rotation_flip": 0.004109077155590057,
      "sparse_tokens": 32089.0,
      "step": 562,
      "turn_loss": 0.10602178424596786,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.026156848169485224,
      "grad_norm": 0.781433641910553,
      "learning_rate": 9.96588409360323e-06,
      "loss": 0.2085,
      "mae_dtheta": 0.029241180047392845,
      "mae_dx": 0.010531298816204071,
      "mae_dy": 0.006203111726790667,
      "pose_mae_dtheta": 0.19259485602378845,
      "pose_mae_dx": 0.08507996797561646,
      "pose_mae_dy": 0.058699559420347214,
      "pose_rmse_dtheta": 0.3120962381362915,
      "pose_rmse_dx": 0.18915942311286926,
      "pose_rmse_dy": 0.12752626836299896,
      "pose_rmse_mean": 0.2095939815044403,
      "rmse_dtheta": 0.04541845619678497,
      "rmse_dx": 0.02213466726243496,
      "rmse_dy": 0.015816831961274147,
      "rmse_mean": 0.02778998576104641,
      "rotation_flip": 0.011461318470537663,
      "sparse_tokens": 6850.0,
      "step": 563,
      "turn_loss": 0.34639206528663635,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.026203307935328005,
      "grad_norm": 0.5015290975570679,
      "learning_rate": 9.965729725144189e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.008589616976678371,
      "mae_dx": 0.002572175581008196,
      "mae_dy": 0.001506681670434773,
      "pose_mae_dtheta": 0.06634104996919632,
      "pose_mae_dx": 0.020756712183356285,
      "pose_mae_dy": 0.019521865993738174,
      "pose_rmse_dtheta": 0.17229364812374115,
      "pose_rmse_dx": 0.06332237273454666,
      "pose_rmse_dy": 0.04777316376566887,
      "pose_rmse_mean": 0.09446306526660919,
      "rmse_dtheta": 0.01992293819785118,
      "rmse_dx": 0.009162303060293198,
      "rmse_dy": 0.004586010705679655,
      "rmse_mean": 0.011223751120269299,
      "rotation_flip": 0.0028368793427944183,
      "sparse_tokens": 32121.0,
      "step": 564,
      "turn_loss": 0.07462040334939957,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.026249767701170785,
      "grad_norm": 0.498135507106781,
      "learning_rate": 9.965575009429006e-06,
      "loss": 0.101,
      "mae_dtheta": 0.00885518454015255,
      "mae_dx": 0.001865712576545775,
      "mae_dy": 0.002349091460928321,
      "pose_mae_dtheta": 0.06245036795735359,
      "pose_mae_dx": 0.024094311520457268,
      "pose_mae_dy": 0.028306789696216583,
      "pose_rmse_dtheta": 0.1234479546546936,
      "pose_rmse_dx": 0.062395527958869934,
      "pose_rmse_dy": 0.06608419120311737,
      "pose_rmse_mean": 0.0839758962392807,
      "rmse_dtheta": 0.018764033913612366,
      "rmse_dx": 0.005581167060881853,
      "rmse_dy": 0.0052590942941606045,
      "rmse_mean": 0.009868098422884941,
      "rotation_flip": 0.005937234964221716,
      "sparse_tokens": 32089.0,
      "step": 565,
      "turn_loss": 0.07734230905771255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.026296227467013565,
      "grad_norm": 0.7090973854064941,
      "learning_rate": 9.965419946468496e-06,
      "loss": 0.1447,
      "mae_dtheta": 0.013681800104677677,
      "mae_dx": 0.0029397171456366777,
      "mae_dy": 0.0030824479181319475,
      "pose_mae_dtheta": 0.0940733551979065,
      "pose_mae_dx": 0.030840814113616943,
      "pose_mae_dy": 0.03757357597351074,
      "pose_rmse_dtheta": 0.2075337916612625,
      "pose_rmse_dx": 0.0730786919593811,
      "pose_rmse_dy": 0.09541504085063934,
      "pose_rmse_mean": 0.12534251809120178,
      "rmse_dtheta": 0.027472099289298058,
      "rmse_dx": 0.008084293454885483,
      "rmse_dy": 0.007090624421834946,
      "rmse_mean": 0.014215672388672829,
      "rotation_flip": 0.008931761607527733,
      "sparse_tokens": 32121.0,
      "step": 566,
      "turn_loss": 0.1177879273891449,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.026342687232856345,
      "grad_norm": 0.4311627745628357,
      "learning_rate": 9.965264536273504e-06,
      "loss": 0.1369,
      "mae_dtheta": 0.011870721355080605,
      "mae_dx": 0.0022863540798425674,
      "mae_dy": 0.003580324351787567,
      "pose_mae_dtheta": 0.0809657871723175,
      "pose_mae_dx": 0.033823803067207336,
      "pose_mae_dy": 0.04305803403258324,
      "pose_rmse_dtheta": 0.1559247225522995,
      "pose_rmse_dx": 0.0891568586230278,
      "pose_rmse_dy": 0.11620306223630905,
      "pose_rmse_mean": 0.12042821943759918,
      "rmse_dtheta": 0.022973567247390747,
      "rmse_dx": 0.00661487877368927,
      "rmse_dy": 0.00890863686800003,
      "rmse_mean": 0.01283236127346754,
      "rotation_flip": 0.006380715873092413,
      "sparse_tokens": 32089.0,
      "step": 567,
      "turn_loss": 0.11174385249614716,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.026389146998699126,
      "grad_norm": 0.6287394165992737,
      "learning_rate": 9.9651087788549e-06,
      "loss": 0.1542,
      "mae_dtheta": 0.03404722362756729,
      "mae_dx": 0.011466212570667267,
      "mae_dy": 0.005503491032868624,
      "pose_mae_dtheta": 0.28280797600746155,
      "pose_mae_dx": 0.07994836568832397,
      "pose_mae_dy": 0.049879178404808044,
      "pose_rmse_dtheta": 0.49817702174186707,
      "pose_rmse_dx": 0.20088645815849304,
      "pose_rmse_dy": 0.1034141406416893,
      "pose_rmse_mean": 0.26749253273010254,
      "rmse_dtheta": 0.052154041826725006,
      "rmse_dx": 0.02322409860789776,
      "rmse_dy": 0.011951991356909275,
      "rmse_mean": 0.029110044240951538,
      "rotation_flip": 0.012089810334146023,
      "sparse_tokens": 10438.0,
      "step": 568,
      "turn_loss": 0.2907644808292389,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.026435606764541906,
      "grad_norm": 0.6150938272476196,
      "learning_rate": 9.964952674223571e-06,
      "loss": 0.1339,
      "mae_dtheta": 0.010493189096450806,
      "mae_dx": 0.0018958155997097492,
      "mae_dy": 0.0022457463201135397,
      "pose_mae_dtheta": 0.07277870178222656,
      "pose_mae_dx": 0.027828404679894447,
      "pose_mae_dy": 0.03135566785931587,
      "pose_rmse_dtheta": 0.15609638392925262,
      "pose_rmse_dx": 0.06290426850318909,
      "pose_rmse_dy": 0.07304227352142334,
      "pose_rmse_mean": 0.09734763950109482,
      "rmse_dtheta": 0.02174375392496586,
      "rmse_dx": 0.00538805453106761,
      "rmse_dy": 0.00470174802467227,
      "rmse_mean": 0.010611185804009438,
      "rotation_flip": 0.00288704433478415,
      "sparse_tokens": 32137.0,
      "step": 569,
      "turn_loss": 0.07576502114534378,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.026482066530384686,
      "grad_norm": 0.8164499402046204,
      "learning_rate": 9.964796222390439e-06,
      "loss": 0.1719,
      "mae_dtheta": 0.0361892431974411,
      "mae_dx": 0.009495092555880547,
      "mae_dy": 0.004221157170832157,
      "pose_mae_dtheta": 0.29971349239349365,
      "pose_mae_dx": 0.09846005588769913,
      "pose_mae_dy": 0.06418415158987045,
      "pose_rmse_dtheta": 0.5410837531089783,
      "pose_rmse_dx": 0.21117769181728363,
      "pose_rmse_dy": 0.15438655018806458,
      "pose_rmse_mean": 0.3022160232067108,
      "rmse_dtheta": 0.05611367151141167,
      "rmse_dx": 0.021149661391973495,
      "rmse_dy": 0.007452028803527355,
      "rmse_mean": 0.028238452970981598,
      "rotation_flip": 0.011337868869304657,
      "sparse_tokens": 7367.0,
      "step": 570,
      "turn_loss": 0.26631641387939453,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.026528526296227466,
      "grad_norm": 0.46606767177581787,
      "learning_rate": 9.964639423366442e-06,
      "loss": 0.1137,
      "mae_dtheta": 0.01223784126341343,
      "mae_dx": 0.002465162891894579,
      "mae_dy": 0.00358623662032187,
      "pose_mae_dtheta": 0.09369289875030518,
      "pose_mae_dx": 0.03435179963707924,
      "pose_mae_dy": 0.04215032234787941,
      "pose_rmse_dtheta": 0.22792889177799225,
      "pose_rmse_dx": 0.09983956068754196,
      "pose_rmse_dy": 0.11315371096134186,
      "pose_rmse_mean": 0.14697405695915222,
      "rmse_dtheta": 0.0262418482452631,
      "rmse_dx": 0.007050344720482826,
      "rmse_dy": 0.008162942714989185,
      "rmse_mean": 0.013818378560245037,
      "rotation_flip": 0.010603589005768299,
      "sparse_tokens": 32073.0,
      "step": 571,
      "turn_loss": 0.10258068889379501,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.026574986062070247,
      "grad_norm": 0.4739587903022766,
      "learning_rate": 9.964482277162547e-06,
      "loss": 0.1414,
      "mae_dtheta": 0.04534135386347771,
      "mae_dx": 0.012033786624670029,
      "mae_dy": 0.0040589310228824615,
      "pose_mae_dtheta": 0.39736419916152954,
      "pose_mae_dx": 0.09888962656259537,
      "pose_mae_dy": 0.04298971965909004,
      "pose_rmse_dtheta": 0.6319858431816101,
      "pose_rmse_dx": 0.23069487512111664,
      "pose_rmse_dy": 0.099425308406353,
      "pose_rmse_mean": 0.3207020163536072,
      "rmse_dtheta": 0.06402981281280518,
      "rmse_dx": 0.0239311084151268,
      "rmse_dy": 0.009585636667907238,
      "rmse_mean": 0.0325155183672905,
      "rotation_flip": 0.012765957042574883,
      "sparse_tokens": 9811.0,
      "step": 572,
      "turn_loss": 0.36998558044433594,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.026621445827913027,
      "grad_norm": 0.6935786008834839,
      "learning_rate": 9.964324783789738e-06,
      "loss": 0.1208,
      "mae_dtheta": 0.04376429319381714,
      "mae_dx": 0.011960593052208424,
      "mae_dy": 0.005712736863642931,
      "pose_mae_dtheta": 0.34063392877578735,
      "pose_mae_dx": 0.08907289803028107,
      "pose_mae_dy": 0.05993553251028061,
      "pose_rmse_dtheta": 0.5858975648880005,
      "pose_rmse_dx": 0.1873505711555481,
      "pose_rmse_dy": 0.13741019368171692,
      "pose_rmse_mean": 0.3035528063774109,
      "rmse_dtheta": 0.06348384916782379,
      "rmse_dx": 0.02338339015841484,
      "rmse_dy": 0.011736532673239708,
      "rmse_mean": 0.032867927104234695,
      "rotation_flip": 0.022190408781170845,
      "sparse_tokens": 22725.0,
      "step": 573,
      "turn_loss": 0.30850327014923096,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.026667905593755807,
      "grad_norm": 0.7006869316101074,
      "learning_rate": 9.964166943259035e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.009648986160755157,
      "mae_dx": 0.0027378012891858816,
      "mae_dy": 0.002311402466148138,
      "pose_mae_dtheta": 0.06459090113639832,
      "pose_mae_dx": 0.03183519467711449,
      "pose_mae_dy": 0.030282221734523773,
      "pose_rmse_dtheta": 0.15696269273757935,
      "pose_rmse_dx": 0.08793357759714127,
      "pose_rmse_dy": 0.0691135972738266,
      "pose_rmse_mean": 0.104669950902462,
      "rmse_dtheta": 0.021487871184945107,
      "rmse_dx": 0.008093439042568207,
      "rmse_dy": 0.005093785002827644,
      "rmse_mean": 0.01155836507678032,
      "rotation_flip": 0.005092592444270849,
      "sparse_tokens": 32089.0,
      "step": 574,
      "turn_loss": 0.1003546491265297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.026714365359598587,
      "grad_norm": 0.907770037651062,
      "learning_rate": 9.964008755581472e-06,
      "loss": 0.1621,
      "mae_dtheta": 0.023149173706769943,
      "mae_dx": 0.01316146645694971,
      "mae_dy": 0.0036913466174155474,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9077699184417725,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 137.4752960205078,
      "model/head/act_norm_mean": 103.8605712890625,
      "model/head/act_norm_min": 75.0499038696289,
      "model/head/act_over_embed": 71.37395694783191,
      "model/head/grad_frac": 0.07529810816049576,
      "model/head/grad_norm": 0.06835335493087769,
      "model/head/grad_zero_frac": 0.00014023412950336933,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.681982421875,
      "model/head/update_ratio": 0.0011952356435358524,
      "model/head/weight_delta": 2.7050654888153076,
      "model/head/weight_delta_rel": 0.04745486006140709,
      "model/head/weight_norm": 57.18818283081055,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.410508394241333,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.410508394241333,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.410508394241333,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2821052117627822,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08843130618333817,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0802752822637558,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.541015625,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0026190215721726418,
      "model/modality_embedder.encoders.pose/weight_delta": 0.7768383026123047,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.025381729006767273,
      "model/modality_embedder.encoders.pose/weight_norm": 30.650867462158203,
      "model/modality_embedder/grad_frac": 0.08843130618333817,
      "model/modality_embedder/grad_norm": 0.0802752822637558,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.541015625,
      "model/modality_embedder/update_ratio": 0.0026190215721726418,
      "model/modality_embedder/weight_delta": 0.7768383026123047,
      "model/modality_embedder/weight_delta_rel": 0.025381729006767273,
      "model/modality_embedder/weight_norm": 30.650867462158203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.1064453125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.587890625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.87521743774414,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.522609908663814,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05463174358010292,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04959305375814438,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001804370665922761,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.3752036392688751,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.013672647066414356,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.48495864868164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.71246337890625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.52118675595238,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.665582656860352,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.163979747510332,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0515408031642437,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.046787191182374954,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016162117244675756,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.4366404116153717,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.015125565230846405,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.94867706298828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.70674133300781,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.249803137400793,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.05776596069336,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.35190110840322,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.050652455538511276,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.045980773866176605,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015394219662994146,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.44513916969299316,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.014946939423680305,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.86885643005371,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 82.35133361816406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.203168402777777,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.723333358764648,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.694272006464026,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05375436693429947,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04879659786820412,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001664079842157662,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.3716126084327698,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.012699955143034458,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.323471069335938,
      "model/normalizer/grad_frac": 0.19317293167114258,
      "model/normalizer/grad_norm": 0.17535658180713654,
      "model/normalizer/grad_zero_frac": 0.0001784424966899678,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0022558511700481176,
      "model/normalizer/weight_delta": 0.840279221534729,
      "model/normalizer/weight_delta_rel": 0.010822310112416744,
      "model/normalizer/weight_norm": 77.7341079711914,
      "pose_mae_dtheta": 0.22471873462200165,
      "pose_mae_dx": 0.10553794354200363,
      "pose_mae_dy": 0.06188936159014702,
      "pose_rmse_dtheta": 0.4303538203239441,
      "pose_rmse_dx": 0.23162928223609924,
      "pose_rmse_dy": 0.1282120794057846,
      "pose_rmse_mean": 0.2633984088897705,
      "rmse_dtheta": 0.04041256010532379,
      "rmse_dx": 0.02531232312321663,
      "rmse_dy": 0.006294747348874807,
      "rmse_mean": 0.024006543681025505,
      "rotation_flip": 0.012500000186264515,
      "sparse_tokens": 5047.0,
      "step": 575,
      "turn_loss": 0.21003663539886475,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.026760825125441368,
      "grad_norm": 1.0300030708312988,
      "learning_rate": 9.963850220768112e-06,
      "loss": 0.3206,
      "mae_dtheta": 0.03291689604520798,
      "mae_dx": 0.004813556559383869,
      "mae_dy": 0.005805452354252338,
      "pose_mae_dtheta": 0.35047614574432373,
      "pose_mae_dx": 0.06225895509123802,
      "pose_mae_dy": 0.10657726973295212,
      "pose_rmse_dtheta": 0.5281227827072144,
      "pose_rmse_dx": 0.1110912412405014,
      "pose_rmse_dy": 0.20902597904205322,
      "pose_rmse_mean": 0.28274667263031006,
      "rmse_dtheta": 0.04788470268249512,
      "rmse_dx": 0.010066155344247818,
      "rmse_dy": 0.00989462435245514,
      "rmse_mean": 0.022615160793066025,
      "rotation_flip": 0.007633587811142206,
      "sparse_tokens": 2282.0,
      "step": 576,
      "turn_loss": 0.24547995626926422,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.026807284891284148,
      "grad_norm": 0.8633906245231628,
      "learning_rate": 9.963691338830045e-06,
      "loss": 0.1663,
      "mae_dtheta": 0.015380527824163437,
      "mae_dx": 0.0024839413817971945,
      "mae_dy": 0.003702441928908229,
      "pose_mae_dtheta": 0.10333848744630814,
      "pose_mae_dx": 0.040927454829216,
      "pose_mae_dy": 0.051375407725572586,
      "pose_rmse_dtheta": 0.1853013038635254,
      "pose_rmse_dx": 0.09044676274061203,
      "pose_rmse_dy": 0.10817795246839523,
      "pose_rmse_mean": 0.12797534465789795,
      "rmse_dtheta": 0.02490631677210331,
      "rmse_dx": 0.006773800123482943,
      "rmse_dy": 0.006494783330708742,
      "rmse_mean": 0.012724967673420906,
      "rotation_flip": 0.007198560517281294,
      "sparse_tokens": 32089.0,
      "step": 577,
      "turn_loss": 0.12534046173095703,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.026853744657126928,
      "grad_norm": 0.7849879264831543,
      "learning_rate": 9.963532109778375e-06,
      "loss": 0.1221,
      "mae_dtheta": 0.007726640440523624,
      "mae_dx": 0.0019415271235629916,
      "mae_dy": 0.0008538977708667517,
      "pose_mae_dtheta": 0.053167033940553665,
      "pose_mae_dx": 0.018123731017112732,
      "pose_mae_dy": 0.014936446212232113,
      "pose_rmse_dtheta": 0.17157895863056183,
      "pose_rmse_dx": 0.04260365292429924,
      "pose_rmse_dy": 0.039081159979104996,
      "pose_rmse_mean": 0.08442126214504242,
      "rmse_dtheta": 0.023956118151545525,
      "rmse_dx": 0.005262245889753103,
      "rmse_dy": 0.0018238485790789127,
      "rmse_mean": 0.010347404517233372,
      "rotation_flip": 0.002411091001704335,
      "sparse_tokens": 32121.0,
      "step": 578,
      "turn_loss": 0.051910970360040665,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.02690020442296971,
      "grad_norm": 0.720867931842804,
      "learning_rate": 9.96337253362424e-06,
      "loss": 0.1151,
      "mae_dtheta": 0.00804265309125185,
      "mae_dx": 0.0020616301335394382,
      "mae_dy": 0.002372107468545437,
      "pose_mae_dtheta": 0.05421964451670647,
      "pose_mae_dx": 0.023278793320059776,
      "pose_mae_dy": 0.022358184680342674,
      "pose_rmse_dtheta": 0.12316813319921494,
      "pose_rmse_dx": 0.05790111795067787,
      "pose_rmse_dy": 0.04405840486288071,
      "pose_rmse_mean": 0.07504256069660187,
      "rmse_dtheta": 0.018379583954811096,
      "rmse_dx": 0.006072896998375654,
      "rmse_dy": 0.005137293133884668,
      "rmse_mean": 0.009863258339464664,
      "rotation_flip": 0.001572945388033986,
      "sparse_tokens": 32105.0,
      "step": 579,
      "turn_loss": 0.07283302396535873,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9729.0,
      "epoch": 0.02694666418881249,
      "grad_norm": 0.5707797408103943,
      "learning_rate": 9.963212610378804e-06,
      "loss": 0.108,
      "mae_dtheta": 0.03671777620911598,
      "mae_dx": 0.014142011292278767,
      "mae_dy": 0.004534672014415264,
      "pose_mae_dtheta": 0.33937516808509827,
      "pose_mae_dx": 0.10519824922084808,
      "pose_mae_dy": 0.06035851314663887,
      "pose_rmse_dtheta": 0.5216729640960693,
      "pose_rmse_dx": 0.2062818557024002,
      "pose_rmse_dy": 0.15590515732765198,
      "pose_rmse_mean": 0.29462000727653503,
      "rmse_dtheta": 0.05417589098215103,
      "rmse_dx": 0.02619355544447899,
      "rmse_dy": 0.010746395215392113,
      "rmse_mean": 0.030371947214007378,
      "rotation_flip": 0.018108651041984558,
      "sparse_tokens": 7213.0,
      "step": 580,
      "turn_loss": 0.3079169988632202,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.02699312395465527,
      "grad_norm": 0.5338557362556458,
      "learning_rate": 9.963052340053242e-06,
      "loss": 0.1713,
      "mae_dtheta": 0.04354694485664368,
      "mae_dx": 0.014232096262276173,
      "mae_dy": 0.0061028809286653996,
      "pose_mae_dtheta": 0.34007909893989563,
      "pose_mae_dx": 0.1090666651725769,
      "pose_mae_dy": 0.06129399687051773,
      "pose_rmse_dtheta": 0.5830497145652771,
      "pose_rmse_dx": 0.2056037038564682,
      "pose_rmse_dy": 0.16289953887462616,
      "pose_rmse_mean": 0.31718432903289795,
      "rmse_dtheta": 0.06310062110424042,
      "rmse_dx": 0.02582930400967598,
      "rmse_dy": 0.012656399980187416,
      "rmse_mean": 0.03386210650205612,
      "rotation_flip": 0.01884816773235798,
      "sparse_tokens": 15222.0,
      "step": 581,
      "turn_loss": 0.3546585440635681,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.02703958372049805,
      "grad_norm": 0.7749821543693542,
      "learning_rate": 9.962891722658767e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.009223327040672302,
      "mae_dx": 0.0021900360006839037,
      "mae_dy": 0.0022769486531615257,
      "pose_mae_dtheta": 0.06773440539836884,
      "pose_mae_dx": 0.025583909824490547,
      "pose_mae_dy": 0.026821637526154518,
      "pose_rmse_dtheta": 0.1679927557706833,
      "pose_rmse_dx": 0.07296784222126007,
      "pose_rmse_dy": 0.06868192553520203,
      "pose_rmse_mean": 0.10321417450904846,
      "rmse_dtheta": 0.021361682564020157,
      "rmse_dx": 0.007530968636274338,
      "rmse_dy": 0.005727504380047321,
      "rmse_mean": 0.01154005154967308,
      "rotation_flip": 0.0041215866804122925,
      "sparse_tokens": 32041.0,
      "step": 582,
      "turn_loss": 0.07667932659387589,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.02708604348634083,
      "grad_norm": 0.7706084251403809,
      "learning_rate": 9.962730758206612e-06,
      "loss": 0.1483,
      "mae_dtheta": 0.02806752175092697,
      "mae_dx": 0.008816651999950409,
      "mae_dy": 0.002643199171870947,
      "pose_mae_dtheta": 0.22259299457073212,
      "pose_mae_dx": 0.06826034188270569,
      "pose_mae_dy": 0.035497214645147324,
      "pose_rmse_dtheta": 0.4377717077732086,
      "pose_rmse_dx": 0.17873615026474,
      "pose_rmse_dy": 0.08952634781599045,
      "pose_rmse_mean": 0.2353447526693344,
      "rmse_dtheta": 0.04695436730980873,
      "rmse_dx": 0.020783482119441032,
      "rmse_dy": 0.005016227252781391,
      "rmse_mean": 0.024251360446214676,
      "rotation_flip": 0.010935601778328419,
      "sparse_tokens": 17457.0,
      "step": 583,
      "turn_loss": 0.19011297821998596,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.02713250325218361,
      "grad_norm": 0.7469168901443481,
      "learning_rate": 9.96256944670803e-06,
      "loss": 0.1622,
      "mae_dtheta": 0.022476177662611008,
      "mae_dx": 0.011165527626872063,
      "mae_dy": 0.00295705976895988,
      "pose_mae_dtheta": 0.1651662141084671,
      "pose_mae_dx": 0.08583449572324753,
      "pose_mae_dy": 0.05266689881682396,
      "pose_rmse_dtheta": 0.2916691303253174,
      "pose_rmse_dx": 0.20092055201530457,
      "pose_rmse_dy": 0.12900128960609436,
      "pose_rmse_mean": 0.20719699561595917,
      "rmse_dtheta": 0.03729598596692085,
      "rmse_dx": 0.023971982300281525,
      "rmse_dy": 0.005853606853634119,
      "rmse_mean": 0.022373858839273453,
      "rotation_flip": 0.008196720853447914,
      "sparse_tokens": 8184.0,
      "step": 584,
      "turn_loss": 0.20633846521377563,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.02717896301802639,
      "grad_norm": 0.41643810272216797,
      "learning_rate": 9.962407788174302e-06,
      "loss": 0.1001,
      "mae_dtheta": 0.014354929327964783,
      "mae_dx": 0.002597830491140485,
      "mae_dy": 0.0021997573785483837,
      "pose_mae_dtheta": 0.10348399728536606,
      "pose_mae_dx": 0.025212517008185387,
      "pose_mae_dy": 0.030009903013706207,
      "pose_rmse_dtheta": 0.26313892006874084,
      "pose_rmse_dx": 0.0646677166223526,
      "pose_rmse_dy": 0.07823409885168076,
      "pose_rmse_mean": 0.135346919298172,
      "rmse_dtheta": 0.03286813199520111,
      "rmse_dx": 0.007681331597268581,
      "rmse_dy": 0.006828738376498222,
      "rmse_mean": 0.015792734920978546,
      "rotation_flip": 0.0038560412358492613,
      "sparse_tokens": 32137.0,
      "step": 585,
      "turn_loss": 0.10640348494052887,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.02722542278386917,
      "grad_norm": 0.6197845339775085,
      "learning_rate": 9.962245782616734e-06,
      "loss": 0.1792,
      "mae_dtheta": 0.0399254634976387,
      "mae_dx": 0.014980512671172619,
      "mae_dy": 0.004852419253438711,
      "pose_mae_dtheta": 0.33034825325012207,
      "pose_mae_dx": 0.13199393451213837,
      "pose_mae_dy": 0.06647791713476181,
      "pose_rmse_dtheta": 0.5455167293548584,
      "pose_rmse_dx": 0.27096253633499146,
      "pose_rmse_dy": 0.14240805804729462,
      "pose_rmse_mean": 0.31962913274765015,
      "rmse_dtheta": 0.05629022791981697,
      "rmse_dx": 0.028151748701930046,
      "rmse_dy": 0.008723362348973751,
      "rmse_mean": 0.031055113300681114,
      "rotation_flip": 0.012987012974917889,
      "sparse_tokens": 19635.0,
      "step": 586,
      "turn_loss": 0.2961527109146118,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.02727188254971195,
      "grad_norm": 0.7522363066673279,
      "learning_rate": 9.962083430046656e-06,
      "loss": 0.1634,
      "mae_dtheta": 0.06441386789083481,
      "mae_dx": 0.02195994183421135,
      "mae_dy": 0.0063109793700277805,
      "pose_mae_dtheta": 0.5972753167152405,
      "pose_mae_dx": 0.1822563260793686,
      "pose_mae_dy": 0.10037106275558472,
      "pose_rmse_dtheta": 0.8779922723770142,
      "pose_rmse_dx": 0.35028988122940063,
      "pose_rmse_dy": 0.20386889576911926,
      "pose_rmse_mean": 0.47738370299339294,
      "rmse_dtheta": 0.08280466496944427,
      "rmse_dx": 0.0359356515109539,
      "rmse_dy": 0.010747150518000126,
      "rmse_mean": 0.04316249117255211,
      "rotation_flip": 0.017699114978313446,
      "sparse_tokens": 7485.0,
      "step": 587,
      "turn_loss": 0.47024911642074585,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 33310.0,
      "epoch": 0.02731834231555473,
      "grad_norm": 0.9465960264205933,
      "learning_rate": 9.96192073047542e-06,
      "loss": 0.3501,
      "mae_dtheta": 0.04463667422533035,
      "mae_dx": 0.01720779947936535,
      "mae_dy": 0.007491594646126032,
      "pose_mae_dtheta": 0.3824164867401123,
      "pose_mae_dx": 0.15224547684192657,
      "pose_mae_dy": 0.07367581874132156,
      "pose_rmse_dtheta": 0.6228644847869873,
      "pose_rmse_dx": 0.2987000644207001,
      "pose_rmse_dy": 0.166764035820961,
      "pose_rmse_mean": 0.3627762198448181,
      "rmse_dtheta": 0.06390193849802017,
      "rmse_dx": 0.02994629740715027,
      "rmse_dy": 0.017024444416165352,
      "rmse_mean": 0.03695756196975708,
      "rotation_flip": 0.013280212879180908,
      "sparse_tokens": 24622.0,
      "step": 588,
      "turn_loss": 0.38078272342681885,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.02736480208139751,
      "grad_norm": 0.6046245098114014,
      "learning_rate": 9.961757683914406e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.009912309236824512,
      "mae_dx": 0.001975191989913583,
      "mae_dy": 0.0010264497250318527,
      "pose_mae_dtheta": 0.07793208211660385,
      "pose_mae_dx": 0.019330410286784172,
      "pose_mae_dy": 0.020143872126936913,
      "pose_rmse_dtheta": 0.2489539533853531,
      "pose_rmse_dx": 0.04969212785363197,
      "pose_rmse_dy": 0.05849304422736168,
      "pose_rmse_mean": 0.11904638260602951,
      "rmse_dtheta": 0.027835365384817123,
      "rmse_dx": 0.005870284512639046,
      "rmse_dy": 0.0023858887143433094,
      "rmse_mean": 0.01203051395714283,
      "rotation_flip": 0.0018203883664682508,
      "sparse_tokens": 32105.0,
      "step": 589,
      "turn_loss": 0.06597699224948883,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.02741126184724029,
      "grad_norm": 0.8369277119636536,
      "learning_rate": 9.961594290375012e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.010871716775000095,
      "mae_dx": 0.0020754593424499035,
      "mae_dy": 0.0021410747431218624,
      "pose_mae_dtheta": 0.08239550143480301,
      "pose_mae_dx": 0.03091510199010372,
      "pose_mae_dy": 0.035064999014139175,
      "pose_rmse_dtheta": 0.18673565983772278,
      "pose_rmse_dx": 0.08423356711864471,
      "pose_rmse_dy": 0.08512408286333084,
      "pose_rmse_mean": 0.11869776248931885,
      "rmse_dtheta": 0.022703154012560844,
      "rmse_dx": 0.007025293540209532,
      "rmse_dy": 0.004752015694975853,
      "rmse_mean": 0.01149348821491003,
      "rotation_flip": 0.002391200279816985,
      "sparse_tokens": 32041.0,
      "step": 590,
      "turn_loss": 0.0901084691286087,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.02745772161308307,
      "grad_norm": 0.42372214794158936,
      "learning_rate": 9.961430549868668e-06,
      "loss": 0.0914,
      "mae_dtheta": 0.009951302781701088,
      "mae_dx": 0.0021308225113898516,
      "mae_dy": 0.0018132614204660058,
      "pose_mae_dtheta": 0.07187335938215256,
      "pose_mae_dx": 0.025759806856513023,
      "pose_mae_dy": 0.024734843522310257,
      "pose_rmse_dtheta": 0.2175440490245819,
      "pose_rmse_dx": 0.07341519743204117,
      "pose_rmse_dy": 0.060812100768089294,
      "pose_rmse_mean": 0.11725711822509766,
      "rmse_dtheta": 0.02352505922317505,
      "rmse_dx": 0.007147622294723988,
      "rmse_dy": 0.003954576328396797,
      "rmse_mean": 0.011542419902980328,
      "rotation_flip": 0.008524240925908089,
      "sparse_tokens": 32025.0,
      "step": 591,
      "turn_loss": 0.08144378662109375,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.02750418137892585,
      "grad_norm": 0.6142137050628662,
      "learning_rate": 9.96126646240682e-06,
      "loss": 0.1578,
      "mae_dtheta": 0.04336075857281685,
      "mae_dx": 0.015334414318203926,
      "mae_dy": 0.009428737685084343,
      "pose_mae_dtheta": 0.31228339672088623,
      "pose_mae_dx": 0.119367316365242,
      "pose_mae_dy": 0.10873722285032272,
      "pose_rmse_dtheta": 0.5156402587890625,
      "pose_rmse_dx": 0.24898351728916168,
      "pose_rmse_dy": 0.228317528963089,
      "pose_rmse_mean": 0.33098042011260986,
      "rmse_dtheta": 0.06089787557721138,
      "rmse_dx": 0.028488917276263237,
      "rmse_dy": 0.016803327947854996,
      "rmse_mean": 0.03539670631289482,
      "rotation_flip": 0.009248554706573486,
      "sparse_tokens": 13648.0,
      "step": 592,
      "turn_loss": 0.39458006620407104,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.027550641144768632,
      "grad_norm": 0.6054955720901489,
      "learning_rate": 9.961102028000948e-06,
      "loss": 0.138,
      "mae_dtheta": 0.04564880207180977,
      "mae_dx": 0.02486552484333515,
      "mae_dy": 0.007207135204225779,
      "pose_mae_dtheta": 0.4200765788555145,
      "pose_mae_dx": 0.22633004188537598,
      "pose_mae_dy": 0.061561018228530884,
      "pose_rmse_dtheta": 0.6196557283401489,
      "pose_rmse_dx": 0.3833947777748108,
      "pose_rmse_dy": 0.11586607247591019,
      "pose_rmse_mean": 0.3729722201824188,
      "rmse_dtheta": 0.06196073815226555,
      "rmse_dx": 0.037781842052936554,
      "rmse_dy": 0.014754150994122028,
      "rmse_mean": 0.03816557675600052,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 4567.0,
      "step": 593,
      "turn_loss": 0.41394779086112976,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.027597100910611412,
      "grad_norm": 0.46491092443466187,
      "learning_rate": 9.960937246662546e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.014715549536049366,
      "mae_dx": 0.0023395544849336147,
      "mae_dy": 0.0027710229624062777,
      "pose_mae_dtheta": 0.10320749133825302,
      "pose_mae_dx": 0.0327862873673439,
      "pose_mae_dy": 0.036786824464797974,
      "pose_rmse_dtheta": 0.22489367425441742,
      "pose_rmse_dx": 0.07517708837985992,
      "pose_rmse_dy": 0.07260569930076599,
      "pose_rmse_mean": 0.12422548979520798,
      "rmse_dtheta": 0.027363246306777,
      "rmse_dx": 0.006998405326157808,
      "rmse_dy": 0.005237627774477005,
      "rmse_mean": 0.01319976057857275,
      "rotation_flip": 0.005117707420140505,
      "sparse_tokens": 32121.0,
      "step": 594,
      "turn_loss": 0.10842616856098175,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27494.0,
      "epoch": 0.027643560676454192,
      "grad_norm": 0.4310514032840729,
      "learning_rate": 9.960772118403142e-06,
      "loss": 0.1233,
      "mae_dtheta": 0.035578615963459015,
      "mae_dx": 0.010576668195426464,
      "mae_dy": 0.0059152040630578995,
      "pose_mae_dtheta": 0.25777119398117065,
      "pose_mae_dx": 0.10053146630525589,
      "pose_mae_dy": 0.08628691732883453,
      "pose_rmse_dtheta": 0.4618242084980011,
      "pose_rmse_dx": 0.227064847946167,
      "pose_rmse_dy": 0.18241439759731293,
      "pose_rmse_mean": 0.29043447971343994,
      "rmse_dtheta": 0.05302250757813454,
      "rmse_dx": 0.022925909608602524,
      "rmse_dy": 0.010535110719501972,
      "rmse_mean": 0.028827844187617302,
      "rotation_flip": 0.01876876875758171,
      "sparse_tokens": 22774.0,
      "step": 595,
      "turn_loss": 0.2214188575744629,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.02769002044229697,
      "grad_norm": 0.5177340507507324,
      "learning_rate": 9.960606643234278e-06,
      "loss": 0.0742,
      "mae_dtheta": 0.009430453181266785,
      "mae_dx": 0.0033647750969976187,
      "mae_dy": 0.000741966359782964,
      "pose_mae_dtheta": 0.06534937024116516,
      "pose_mae_dx": 0.030580727383494377,
      "pose_mae_dy": 0.008782344870269299,
      "pose_rmse_dtheta": 0.22743172943592072,
      "pose_rmse_dx": 0.08835501968860626,
      "pose_rmse_dy": 0.029677407816052437,
      "pose_rmse_mean": 0.11515472829341888,
      "rmse_dtheta": 0.029290122911334038,
      "rmse_dx": 0.00932397786527872,
      "rmse_dy": 0.0020751708652824163,
      "rmse_mean": 0.013563090935349464,
      "rotation_flip": 0.004176611080765724,
      "sparse_tokens": 32201.0,
      "step": 596,
      "turn_loss": 0.0876416489481926,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2958.0,
      "epoch": 0.02773648020813975,
      "grad_norm": 0.6696729063987732,
      "learning_rate": 9.960440821167532e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.0513644702732563,
      "mae_dx": 0.0157073475420475,
      "mae_dy": 0.016406172886490822,
      "pose_mae_dtheta": 0.3958919644355774,
      "pose_mae_dx": 0.14379750192165375,
      "pose_mae_dy": 0.11759603768587112,
      "pose_rmse_dtheta": 0.5018945932388306,
      "pose_rmse_dx": 0.3055954873561859,
      "pose_rmse_dy": 0.20104457437992096,
      "pose_rmse_mean": 0.3361782431602478,
      "rmse_dtheta": 0.06226678192615509,
      "rmse_dx": 0.025179460644721985,
      "rmse_dy": 0.025846298784017563,
      "rmse_mean": 0.037764184176921844,
      "rotation_flip": 0.03875968977808952,
      "sparse_tokens": 2463.0,
      "step": 597,
      "turn_loss": 0.5602395534515381,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.02778293997398253,
      "grad_norm": 0.4766375422477722,
      "learning_rate": 9.960274652214496e-06,
      "loss": 0.1251,
      "mae_dtheta": 0.03898603469133377,
      "mae_dx": 0.01302482932806015,
      "mae_dy": 0.00590851716697216,
      "pose_mae_dtheta": 0.3065042197704315,
      "pose_mae_dx": 0.09586575627326965,
      "pose_mae_dy": 0.068040631711483,
      "pose_rmse_dtheta": 0.5183284282684326,
      "pose_rmse_dx": 0.19974686205387115,
      "pose_rmse_dy": 0.14606733620166779,
      "pose_rmse_mean": 0.28804755210876465,
      "rmse_dtheta": 0.05631406232714653,
      "rmse_dx": 0.02526433765888214,
      "rmse_dy": 0.011103090830147266,
      "rmse_mean": 0.030893832445144653,
      "rotation_flip": 0.011677281931042671,
      "sparse_tokens": 16036.0,
      "step": 598,
      "turn_loss": 0.3108923137187958,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.02782939973982531,
      "grad_norm": 0.5519424080848694,
      "learning_rate": 9.960108136386792e-06,
      "loss": 0.1187,
      "mae_dtheta": 0.009895495139062405,
      "mae_dx": 0.002428395440801978,
      "mae_dy": 0.002743164310231805,
      "pose_mae_dtheta": 0.07574555277824402,
      "pose_mae_dx": 0.03586005046963692,
      "pose_mae_dy": 0.03664699196815491,
      "pose_rmse_dtheta": 0.1966496855020523,
      "pose_rmse_dx": 0.095421202480793,
      "pose_rmse_dy": 0.11613477021455765,
      "pose_rmse_mean": 0.13606855273246765,
      "rmse_dtheta": 0.02445940487086773,
      "rmse_dx": 0.007203991524875164,
      "rmse_dy": 0.0076993596740067005,
      "rmse_mean": 0.013120918534696102,
      "rotation_flip": 0.009414225816726685,
      "sparse_tokens": 32089.0,
      "step": 599,
      "turn_loss": 0.08334306627511978,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.02787585950566809,
      "grad_norm": 0.5161118507385254,
      "learning_rate": 9.959941273696062e-06,
      "loss": 0.1546,
      "mae_dtheta": 0.04221678152680397,
      "mae_dx": 0.017810482531785965,
      "mae_dy": 0.004072909243404865,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5161117911338806,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 107.63925170898438,
      "model/head/act_norm_mean": 91.22536214192708,
      "model/head/act_norm_min": 68.8882064819336,
      "model/head/act_over_embed": 62.69092292922868,
      "model/head/grad_frac": 0.12164875864982605,
      "model/head/grad_norm": 0.0627843588590622,
      "model/head/grad_zero_frac": 0.0001779894664650783,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6784396701388888,
      "model/head/update_ratio": 0.0010976861231029034,
      "model/head/weight_delta": 2.755844831466675,
      "model/head/weight_delta_rel": 0.04834568127989769,
      "model/head/weight_norm": 57.19700622558594,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41034018993377686,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41034018993377686,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41034018993377686,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28198962018787604,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05998402088880539,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03095846064388752,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.541015625,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010099237551912665,
      "model/modality_embedder.encoders.pose/weight_delta": 0.801319420337677,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.026181602850556374,
      "model/modality_embedder.encoders.pose/weight_norm": 30.654254913330078,
      "model/modality_embedder/grad_frac": 0.05998402088880539,
      "model/modality_embedder/grad_norm": 0.03095846064388752,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.541015625,
      "model/modality_embedder/update_ratio": 0.0010099237551912665,
      "model/modality_embedder/weight_delta": 0.801319420337677,
      "model/modality_embedder/weight_delta_rel": 0.026181602850556374,
      "model/modality_embedder/weight_norm": 30.654254913330078,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 54.67810821533203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.459773203262788,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.029911041259766,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.747357054844299,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09304880350828171,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.048023585230112076,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017471413593739271,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.3855760097503662,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.014050622470676899,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.486948013305664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 56.21882247924805,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.371496775793652,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.849398612976074,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.373902029578076,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09489414840936661,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04897598922252655,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001691583194769919,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.44926080107688904,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.015562745742499828,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.9527530670166,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 58.438438415527344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.058772872574956,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.232382774353027,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.533413959813885,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.1004590094089508,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05184808000922203,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017356385942548513,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.4588080942630768,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.01540591660887003,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.87262535095215,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 59.392784118652344,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.046875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.84229564666748,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 17.899656354685742,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11581433564424515,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.059773143380880356,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002038290724158287,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.3829742670059204,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.013088243082165718,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.325132369995117,
      "model/normalizer/grad_frac": 0.45148903131484985,
      "model/normalizer/grad_norm": 0.23301881551742554,
      "model/normalizer/grad_zero_frac": 0.00017607901827432215,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0029974898789077997,
      "model/normalizer/weight_delta": 0.8651080131530762,
      "model/normalizer/weight_delta_rel": 0.01114208996295929,
      "model/normalizer/weight_norm": 77.73798370361328,
      "pose_mae_dtheta": 0.355790376663208,
      "pose_mae_dx": 0.1500108689069748,
      "pose_mae_dy": 0.05959685891866684,
      "pose_rmse_dtheta": 0.5925816893577576,
      "pose_rmse_dx": 0.2871488928794861,
      "pose_rmse_dy": 0.15761902928352356,
      "pose_rmse_mean": 0.34578320384025574,
      "rmse_dtheta": 0.060301005840301514,
      "rmse_dx": 0.03074108064174652,
      "rmse_dy": 0.008867811411619186,
      "rmse_mean": 0.03330330178141594,
      "rotation_flip": 0.0066225165501236916,
      "sparse_tokens": 9045.0,
      "step": 600,
      "turn_loss": 0.3198513984680176,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "epoch": 0.02787585950566809,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.33525386452674866,
      "eval_objectnav_nopose_mae_dtheta": 0.04218705743551254,
      "eval_objectnav_nopose_mae_dx": 0.014294212684035301,
      "eval_objectnav_nopose_mae_dy": 0.005293951369822025,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.34809234738349915,
      "eval_objectnav_nopose_pose_mae_dx": 0.11585739254951477,
      "eval_objectnav_nopose_pose_mae_dy": 0.061441417783498764,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5733590126037598,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24717086553573608,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14078857004642487,
      "eval_objectnav_nopose_pose_rmse_mean": 0.32043948769569397,
      "eval_objectnav_nopose_rmse_dtheta": 0.05953918769955635,
      "eval_objectnav_nopose_rmse_dx": 0.027038976550102234,
      "eval_objectnav_nopose_rmse_dy": 0.01064012385904789,
      "eval_objectnav_nopose_rmse_mean": 0.032406095415353775,
      "eval_objectnav_nopose_rotation_flip": 0.013688288629055023,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.33525386452674866,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 600
    },
    {
      "epoch": 0.02787585950566809,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2947107255458832,
      "eval_objectnav_pose_mae_dtheta": 0.03633866459131241,
      "eval_objectnav_pose_mae_dx": 0.011991309933364391,
      "eval_objectnav_pose_mae_dy": 0.005002427846193314,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2794733941555023,
      "eval_objectnav_pose_pose_mae_dx": 0.09796638041734695,
      "eval_objectnav_pose_pose_mae_dy": 0.05547700449824333,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.48709481954574585,
      "eval_objectnav_pose_pose_rmse_dx": 0.2219306081533432,
      "eval_objectnav_pose_pose_rmse_dy": 0.13218753039836884,
      "eval_objectnav_pose_pose_rmse_mean": 0.28040432929992676,
      "eval_objectnav_pose_rmse_dtheta": 0.054040782153606415,
      "eval_objectnav_pose_rmse_dx": 0.024391070008277893,
      "eval_objectnav_pose_rmse_dy": 0.010617820546030998,
      "eval_objectnav_pose_rmse_mean": 0.029683224856853485,
      "eval_objectnav_pose_rotation_flip": 0.012205254286527634,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2947107255458832,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 600
    },
    {
      "epoch": 0.02787585950566809,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.11047704517841339,
      "eval_pointnav_mae_dtheta": 0.012376436963677406,
      "eval_pointnav_mae_dx": 0.003188569564372301,
      "eval_pointnav_mae_dy": 0.0026948514860123396,
      "eval_pointnav_pose_mae_dtheta": 0.08960537612438202,
      "eval_pointnav_pose_mae_dx": 0.03516252338886261,
      "eval_pointnav_pose_mae_dy": 0.03136802092194557,
      "eval_pointnav_pose_rmse_dtheta": 0.23734848201274872,
      "eval_pointnav_pose_rmse_dx": 0.09929172694683075,
      "eval_pointnav_pose_rmse_dy": 0.08830060809850693,
      "eval_pointnav_pose_rmse_mean": 0.14164695143699646,
      "eval_pointnav_rmse_dtheta": 0.028419559821486473,
      "eval_pointnav_rmse_dx": 0.009416624903678894,
      "eval_pointnav_rmse_dy": 0.0070991008542478085,
      "eval_pointnav_rmse_mean": 0.014978429302573204,
      "eval_pointnav_rotation_flip": 0.004674934316426516,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.11047704517841339,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 600
    },
    {
      "epoch": 0.02787585950566809,
      "eval_loss": 0.24681387841701508,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.33525386452674866,
      "eval_objectnav_nopose_mae_dtheta": 0.04218705743551254,
      "eval_objectnav_nopose_mae_dx": 0.014294212684035301,
      "eval_objectnav_nopose_mae_dy": 0.005293951369822025,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.34809234738349915,
      "eval_objectnav_nopose_pose_mae_dx": 0.11585739254951477,
      "eval_objectnav_nopose_pose_mae_dy": 0.061441417783498764,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5733590126037598,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24717086553573608,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14078857004642487,
      "eval_objectnav_nopose_pose_rmse_mean": 0.32043948769569397,
      "eval_objectnav_nopose_rmse_dtheta": 0.05953918769955635,
      "eval_objectnav_nopose_rmse_dx": 0.027038976550102234,
      "eval_objectnav_nopose_rmse_dy": 0.01064012385904789,
      "eval_objectnav_nopose_rmse_mean": 0.032406095415353775,
      "eval_objectnav_nopose_rotation_flip": 0.013688288629055023,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.33525386452674866,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2947107255458832,
      "eval_objectnav_pose_mae_dtheta": 0.03633866459131241,
      "eval_objectnav_pose_mae_dx": 0.011991309933364391,
      "eval_objectnav_pose_mae_dy": 0.005002427846193314,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2794733941555023,
      "eval_objectnav_pose_pose_mae_dx": 0.09796638041734695,
      "eval_objectnav_pose_pose_mae_dy": 0.05547700449824333,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.48709481954574585,
      "eval_objectnav_pose_pose_rmse_dx": 0.2219306081533432,
      "eval_objectnav_pose_pose_rmse_dy": 0.13218753039836884,
      "eval_objectnav_pose_pose_rmse_mean": 0.28040432929992676,
      "eval_objectnav_pose_rmse_dtheta": 0.054040782153606415,
      "eval_objectnav_pose_rmse_dx": 0.024391070008277893,
      "eval_objectnav_pose_rmse_dy": 0.010617820546030998,
      "eval_objectnav_pose_rmse_mean": 0.029683224856853485,
      "eval_objectnav_pose_rotation_flip": 0.012205254286527634,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2947107255458832,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.11047704517841339,
      "eval_pointnav_mae_dtheta": 0.012376436963677406,
      "eval_pointnav_mae_dx": 0.003188569564372301,
      "eval_pointnav_mae_dy": 0.0026948514860123396,
      "eval_pointnav_pose_mae_dtheta": 0.08960537612438202,
      "eval_pointnav_pose_mae_dx": 0.03516252338886261,
      "eval_pointnav_pose_mae_dy": 0.03136802092194557,
      "eval_pointnav_pose_rmse_dtheta": 0.23734848201274872,
      "eval_pointnav_pose_rmse_dx": 0.09929172694683075,
      "eval_pointnav_pose_rmse_dy": 0.08830060809850693,
      "eval_pointnav_pose_rmse_mean": 0.14164695143699646,
      "eval_pointnav_rmse_dtheta": 0.028419559821486473,
      "eval_pointnav_rmse_dx": 0.009416624903678894,
      "eval_pointnav_rmse_dy": 0.0070991008542478085,
      "eval_pointnav_rmse_mean": 0.014978429302573204,
      "eval_pointnav_rotation_flip": 0.004674934316426516,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.11047704517841339,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 600
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.02792231927151087,
      "grad_norm": 0.6051998138427734,
      "learning_rate": 9.959774064153977e-06,
      "loss": 0.1887,
      "mae_dtheta": 0.010994892567396164,
      "mae_dx": 0.0020362790673971176,
      "mae_dy": 0.0016725511522963643,
      "pose_mae_dtheta": 0.08165169507265091,
      "pose_mae_dx": 0.023269586265087128,
      "pose_mae_dy": 0.022524110972881317,
      "pose_rmse_dtheta": 0.2669415771961212,
      "pose_rmse_dx": 0.060358356684446335,
      "pose_rmse_dy": 0.07117164134979248,
      "pose_rmse_mean": 0.1328238546848297,
      "rmse_dtheta": 0.030252676457166672,
      "rmse_dx": 0.006281949579715729,
      "rmse_dy": 0.004397208336740732,
      "rmse_mean": 0.013643945567309856,
      "rotation_flip": 0.004043905064463615,
      "sparse_tokens": 32073.0,
      "step": 601,
      "turn_loss": 0.09569084644317627,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.02796877903735365,
      "grad_norm": 0.3347492814064026,
      "learning_rate": 9.95960650777223e-06,
      "loss": 0.0915,
      "mae_dtheta": 0.008126446045935154,
      "mae_dx": 0.0020508794113993645,
      "mae_dy": 0.0018120859749615192,
      "pose_mae_dtheta": 0.05985451489686966,
      "pose_mae_dx": 0.023519128561019897,
      "pose_mae_dy": 0.02457682229578495,
      "pose_rmse_dtheta": 0.1531410962343216,
      "pose_rmse_dx": 0.06447575241327286,
      "pose_rmse_dy": 0.07051203399896622,
      "pose_rmse_mean": 0.09604296088218689,
      "rmse_dtheta": 0.01972370594739914,
      "rmse_dx": 0.006401837803423405,
      "rmse_dy": 0.0050619421526789665,
      "rmse_mean": 0.010395828634500504,
      "rotation_flip": 0.005263158120214939,
      "sparse_tokens": 32105.0,
      "step": 602,
      "turn_loss": 0.0741286501288414,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.02801523880319643,
      "grad_norm": 0.4527236223220825,
      "learning_rate": 9.95943860456254e-06,
      "loss": 0.1204,
      "mae_dtheta": 0.010399661026895046,
      "mae_dx": 0.001843476900830865,
      "mae_dy": 0.002196818357333541,
      "pose_mae_dtheta": 0.07233136892318726,
      "pose_mae_dx": 0.0234871506690979,
      "pose_mae_dy": 0.030766239389777184,
      "pose_rmse_dtheta": 0.16550277173519135,
      "pose_rmse_dx": 0.06457690894603729,
      "pose_rmse_dy": 0.08193918317556381,
      "pose_rmse_mean": 0.10400629043579102,
      "rmse_dtheta": 0.021694540977478027,
      "rmse_dx": 0.005856900010257959,
      "rmse_dy": 0.005197684280574322,
      "rmse_mean": 0.010916374623775482,
      "rotation_flip": 0.004642525687813759,
      "sparse_tokens": 32089.0,
      "step": 603,
      "turn_loss": 0.09229361265897751,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11992.0,
      "epoch": 0.02806169856903921,
      "grad_norm": 0.9042289853096008,
      "learning_rate": 9.959270354536644e-06,
      "loss": 0.2712,
      "mae_dtheta": 0.025719905272126198,
      "mae_dx": 0.012497905641794205,
      "mae_dy": 0.004527727607637644,
      "pose_mae_dtheta": 0.21260660886764526,
      "pose_mae_dx": 0.1108083575963974,
      "pose_mae_dy": 0.04692037031054497,
      "pose_rmse_dtheta": 0.3441617488861084,
      "pose_rmse_dx": 0.26072466373443604,
      "pose_rmse_dy": 0.09337948262691498,
      "pose_rmse_mean": 0.23275530338287354,
      "rmse_dtheta": 0.038030363619327545,
      "rmse_dx": 0.026105260476469994,
      "rmse_dy": 0.008482160046696663,
      "rmse_mean": 0.024205928668379784,
      "rotation_flip": 0.007590132765471935,
      "sparse_tokens": 9648.0,
      "step": 604,
      "turn_loss": 0.22675570845603943,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.02810815833488199,
      "grad_norm": 0.49266400933265686,
      "learning_rate": 9.959101757706308e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.01166821364313364,
      "mae_dx": 0.001770827337168157,
      "mae_dy": 0.002345114015042782,
      "pose_mae_dtheta": 0.08496745675802231,
      "pose_mae_dx": 0.024631468579173088,
      "pose_mae_dy": 0.033868856728076935,
      "pose_rmse_dtheta": 0.19816741347312927,
      "pose_rmse_dx": 0.06333359330892563,
      "pose_rmse_dy": 0.08361254632472992,
      "pose_rmse_mean": 0.11503785848617554,
      "rmse_dtheta": 0.024106746539473534,
      "rmse_dx": 0.005149352364242077,
      "rmse_dy": 0.005358054302632809,
      "rmse_mean": 0.011538051068782806,
      "rotation_flip": 0.003829787252470851,
      "sparse_tokens": 32089.0,
      "step": 605,
      "turn_loss": 0.0895116999745369,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.02815461810072477,
      "grad_norm": 0.5343642830848694,
      "learning_rate": 9.958932814083328e-06,
      "loss": 0.1696,
      "mae_dtheta": 0.013866246677935123,
      "mae_dx": 0.004940449260175228,
      "mae_dy": 0.004250196274369955,
      "pose_mae_dtheta": 0.10566696524620056,
      "pose_mae_dx": 0.03874114155769348,
      "pose_mae_dy": 0.038774680346250534,
      "pose_rmse_dtheta": 0.28715744614601135,
      "pose_rmse_dx": 0.10874716937541962,
      "pose_rmse_dy": 0.11044754832983017,
      "pose_rmse_mean": 0.16878405213356018,
      "rmse_dtheta": 0.03278394415974617,
      "rmse_dx": 0.014222519472241402,
      "rmse_dy": 0.013761647045612335,
      "rmse_mean": 0.02025603875517845,
      "rotation_flip": 0.0062953997403383255,
      "sparse_tokens": 32121.0,
      "step": 606,
      "turn_loss": 0.16109827160835266,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.028201077866567552,
      "grad_norm": 0.5136465430259705,
      "learning_rate": 9.958763523679515e-06,
      "loss": 0.1276,
      "mae_dtheta": 0.01384902372956276,
      "mae_dx": 0.002207186073064804,
      "mae_dy": 0.0039724139496684074,
      "pose_mae_dtheta": 0.0961400493979454,
      "pose_mae_dx": 0.035991571843624115,
      "pose_mae_dy": 0.046736955642700195,
      "pose_rmse_dtheta": 0.2067483365535736,
      "pose_rmse_dx": 0.0903482511639595,
      "pose_rmse_dy": 0.12561199069023132,
      "pose_rmse_mean": 0.14090286195278168,
      "rmse_dtheta": 0.026542536914348602,
      "rmse_dx": 0.00534899951890111,
      "rmse_dy": 0.00869718473404646,
      "rmse_mean": 0.013529574498534203,
      "rotation_flip": 0.008514986373484135,
      "sparse_tokens": 32121.0,
      "step": 607,
      "turn_loss": 0.12588118016719818,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.028247537632410332,
      "grad_norm": 0.7263182401657104,
      "learning_rate": 9.958593886506704e-06,
      "loss": 0.1191,
      "mae_dtheta": 0.03232304006814957,
      "mae_dx": 0.012426614761352539,
      "mae_dy": 0.008609148673713207,
      "pose_mae_dtheta": 0.2749936580657959,
      "pose_mae_dx": 0.11474398523569107,
      "pose_mae_dy": 0.0945458933711052,
      "pose_rmse_dtheta": 0.462472528219223,
      "pose_rmse_dx": 0.2189551442861557,
      "pose_rmse_dy": 0.2014816403388977,
      "pose_rmse_mean": 0.29430311918258667,
      "rmse_dtheta": 0.049335163086652756,
      "rmse_dx": 0.02418454736471176,
      "rmse_dy": 0.0168088898062706,
      "rmse_mean": 0.030109532177448273,
      "rotation_flip": 0.015384615398943424,
      "sparse_tokens": 5871.0,
      "step": 608,
      "turn_loss": 0.2622097134590149,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.028293997398253112,
      "grad_norm": 0.4853295087814331,
      "learning_rate": 9.958423902576764e-06,
      "loss": 0.0818,
      "mae_dtheta": 0.03441304713487625,
      "mae_dx": 0.009198198094964027,
      "mae_dy": 0.004723317921161652,
      "pose_mae_dtheta": 0.3123873174190521,
      "pose_mae_dx": 0.05903095379471779,
      "pose_mae_dy": 0.0732705146074295,
      "pose_rmse_dtheta": 0.581030011177063,
      "pose_rmse_dx": 0.14231106638908386,
      "pose_rmse_dy": 0.16348238289356232,
      "pose_rmse_mean": 0.2956078350543976,
      "rmse_dtheta": 0.0542827807366848,
      "rmse_dx": 0.020367765799164772,
      "rmse_dy": 0.008277718909084797,
      "rmse_mean": 0.027642756700515747,
      "rotation_flip": 0.004819277208298445,
      "sparse_tokens": 7724.0,
      "step": 609,
      "turn_loss": 0.2149713784456253,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.028340457164095893,
      "grad_norm": 0.5045239329338074,
      "learning_rate": 9.95825357190158e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.01592826656997204,
      "mae_dx": 0.0027206854429095984,
      "mae_dy": 0.004345112945884466,
      "pose_mae_dtheta": 0.10825536400079727,
      "pose_mae_dx": 0.036991775035858154,
      "pose_mae_dy": 0.05267348140478134,
      "pose_rmse_dtheta": 0.24202539026737213,
      "pose_rmse_dx": 0.08365906774997711,
      "pose_rmse_dy": 0.15840044617652893,
      "pose_rmse_mean": 0.16136163473129272,
      "rmse_dtheta": 0.029709279537200928,
      "rmse_dx": 0.007099456153810024,
      "rmse_dy": 0.010055423714220524,
      "rmse_mean": 0.015621386468410492,
      "rotation_flip": 0.005291005130857229,
      "sparse_tokens": 32121.0,
      "step": 610,
      "turn_loss": 0.13839279115200043,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.028386916929938673,
      "grad_norm": 0.8114443421363831,
      "learning_rate": 9.95808289449306e-06,
      "loss": 0.1381,
      "mae_dtheta": 0.0482134073972702,
      "mae_dx": 0.016642292961478233,
      "mae_dy": 0.005645783618092537,
      "pose_mae_dtheta": 0.39340466260910034,
      "pose_mae_dx": 0.12339713424444199,
      "pose_mae_dy": 0.059895109385252,
      "pose_rmse_dtheta": 0.6319720149040222,
      "pose_rmse_dx": 0.27593016624450684,
      "pose_rmse_dy": 0.1321321427822113,
      "pose_rmse_mean": 0.34667810797691345,
      "rmse_dtheta": 0.06650839000940323,
      "rmse_dx": 0.03088497929275036,
      "rmse_dy": 0.01175027433782816,
      "rmse_mean": 0.03638121485710144,
      "rotation_flip": 0.01690821163356304,
      "sparse_tokens": 7130.0,
      "step": 611,
      "turn_loss": 0.3246450424194336,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.028433376695781453,
      "grad_norm": 0.453962117433548,
      "learning_rate": 9.957911870363142e-06,
      "loss": 0.121,
      "mae_dtheta": 0.01074628159403801,
      "mae_dx": 0.001774678472429514,
      "mae_dy": 0.0023428003769367933,
      "pose_mae_dtheta": 0.07206351310014725,
      "pose_mae_dx": 0.021657098084688187,
      "pose_mae_dy": 0.029634032398462296,
      "pose_rmse_dtheta": 0.1884203851222992,
      "pose_rmse_dx": 0.05469974875450134,
      "pose_rmse_dy": 0.08442970365285873,
      "pose_rmse_mean": 0.10918328166007996,
      "rmse_dtheta": 0.023938829079270363,
      "rmse_dx": 0.005351664032787085,
      "rmse_dy": 0.005230245180428028,
      "rmse_mean": 0.011506913229823112,
      "rotation_flip": 0.0036945813335478306,
      "sparse_tokens": 32105.0,
      "step": 612,
      "turn_loss": 0.09153158217668533,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17860.0,
      "epoch": 0.028479836461624233,
      "grad_norm": 0.5325713753700256,
      "learning_rate": 9.957740499523787e-06,
      "loss": 0.15,
      "mae_dtheta": 0.0279852282255888,
      "mae_dx": 0.01013973355293274,
      "mae_dy": 0.0019483448704704642,
      "pose_mae_dtheta": 0.22427114844322205,
      "pose_mae_dx": 0.08604919165372849,
      "pose_mae_dy": 0.023412853479385376,
      "pose_rmse_dtheta": 0.4119822680950165,
      "pose_rmse_dx": 0.21769677102565765,
      "pose_rmse_dy": 0.0709695816040039,
      "pose_rmse_mean": 0.23354953527450562,
      "rmse_dtheta": 0.04706163704395294,
      "rmse_dx": 0.022423570975661278,
      "rmse_dy": 0.004339797887951136,
      "rmse_mean": 0.02460833638906479,
      "rotation_flip": 0.016304347664117813,
      "sparse_tokens": 12910.0,
      "step": 613,
      "turn_loss": 0.1954769790172577,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.028526296227467014,
      "grad_norm": 0.7503082156181335,
      "learning_rate": 9.957568781986977e-06,
      "loss": 0.1884,
      "mae_dtheta": 0.012125611305236816,
      "mae_dx": 0.00543806329369545,
      "mae_dy": 0.004748598672449589,
      "pose_mae_dtheta": 0.08860830962657928,
      "pose_mae_dx": 0.051149409264326096,
      "pose_mae_dy": 0.0434163473546505,
      "pose_rmse_dtheta": 0.1897301971912384,
      "pose_rmse_dx": 0.15242156386375427,
      "pose_rmse_dy": 0.12922517955303192,
      "pose_rmse_mean": 0.15712565183639526,
      "rmse_dtheta": 0.024388497695326805,
      "rmse_dx": 0.014799484983086586,
      "rmse_dy": 0.012756595388054848,
      "rmse_mean": 0.017314858734607697,
      "rotation_flip": 0.005041411612182856,
      "sparse_tokens": 32201.0,
      "step": 614,
      "turn_loss": 0.17346584796905518,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.028572755993309794,
      "grad_norm": 0.5175638198852539,
      "learning_rate": 9.957396717764723e-06,
      "loss": 0.1406,
      "mae_dtheta": 0.03625429794192314,
      "mae_dx": 0.012181983329355717,
      "mae_dy": 0.004306933842599392,
      "pose_mae_dtheta": 0.303643137216568,
      "pose_mae_dx": 0.10016132891178131,
      "pose_mae_dy": 0.05223589763045311,
      "pose_rmse_dtheta": 0.4917031228542328,
      "pose_rmse_dx": 0.227652445435524,
      "pose_rmse_dy": 0.17135173082351685,
      "pose_rmse_mean": 0.29690244793891907,
      "rmse_dtheta": 0.05309779569506645,
      "rmse_dx": 0.024249061942100525,
      "rmse_dy": 0.014576597139239311,
      "rmse_mean": 0.03064115345478058,
      "rotation_flip": 0.014627659693360329,
      "sparse_tokens": 12254.0,
      "step": 615,
      "turn_loss": 0.22055865824222565,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.028619215759152574,
      "grad_norm": 0.6195717453956604,
      "learning_rate": 9.957224306869053e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.010184803046286106,
      "mae_dx": 0.0038908717688173056,
      "mae_dy": 0.0018143205670639873,
      "pose_mae_dtheta": 0.06396140903234482,
      "pose_mae_dx": 0.036260299384593964,
      "pose_mae_dy": 0.026405304670333862,
      "pose_rmse_dtheta": 0.17238210141658783,
      "pose_rmse_dx": 0.09695179760456085,
      "pose_rmse_dy": 0.06544419378042221,
      "pose_rmse_mean": 0.11159270256757736,
      "rmse_dtheta": 0.023979507386684418,
      "rmse_dx": 0.011864304542541504,
      "rmse_dy": 0.003752024844288826,
      "rmse_mean": 0.01319861225783825,
      "rotation_flip": 0.003989844117313623,
      "sparse_tokens": 32153.0,
      "step": 616,
      "turn_loss": 0.13073435425758362,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.028665675524995354,
      "grad_norm": 0.6986132264137268,
      "learning_rate": 9.957051549312028e-06,
      "loss": 0.1813,
      "mae_dtheta": 0.03287362679839134,
      "mae_dx": 0.016187168657779694,
      "mae_dy": 0.0031306645832955837,
      "pose_mae_dtheta": 0.26644977927207947,
      "pose_mae_dx": 0.14005877077579498,
      "pose_mae_dy": 0.0478706955909729,
      "pose_rmse_dtheta": 0.45613032579421997,
      "pose_rmse_dx": 0.3262568414211273,
      "pose_rmse_dy": 0.11173377186059952,
      "pose_rmse_mean": 0.29804033041000366,
      "rmse_dtheta": 0.04711102694272995,
      "rmse_dx": 0.03198424354195595,
      "rmse_dy": 0.0055158669129014015,
      "rmse_mean": 0.02820371463894844,
      "rotation_flip": 0.010362694039940834,
      "sparse_tokens": 5868.0,
      "step": 617,
      "turn_loss": 0.2723037004470825,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.028712135290838135,
      "grad_norm": 0.6505441665649414,
      "learning_rate": 9.956878445105727e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.01232467032968998,
      "mae_dx": 0.003002197714522481,
      "mae_dy": 0.00296571827493608,
      "pose_mae_dtheta": 0.0974358469247818,
      "pose_mae_dx": 0.03299685940146446,
      "pose_mae_dy": 0.03797166422009468,
      "pose_rmse_dtheta": 0.23693455755710602,
      "pose_rmse_dx": 0.09395149350166321,
      "pose_rmse_dy": 0.09816419333219528,
      "pose_rmse_mean": 0.1430167555809021,
      "rmse_dtheta": 0.028326399624347687,
      "rmse_dx": 0.009426906704902649,
      "rmse_dy": 0.008313784375786781,
      "rmse_mean": 0.015355696901679039,
      "rotation_flip": 0.008116883225739002,
      "sparse_tokens": 32137.0,
      "step": 618,
      "turn_loss": 0.13087263703346252,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.028758595056680915,
      "grad_norm": 0.7062774896621704,
      "learning_rate": 9.956704994262256e-06,
      "loss": 0.1475,
      "mae_dtheta": 0.010368797928094864,
      "mae_dx": 0.002194796921685338,
      "mae_dy": 0.002289807191118598,
      "pose_mae_dtheta": 0.06700405478477478,
      "pose_mae_dx": 0.02460664138197899,
      "pose_mae_dy": 0.031782764941453934,
      "pose_rmse_dtheta": 0.1334948092699051,
      "pose_rmse_dx": 0.06292756646871567,
      "pose_rmse_dy": 0.06613163650035858,
      "pose_rmse_mean": 0.08751799911260605,
      "rmse_dtheta": 0.021469343453645706,
      "rmse_dx": 0.006595117971301079,
      "rmse_dy": 0.005171833094209433,
      "rmse_mean": 0.011078765615820885,
      "rotation_flip": 0.004259850829839706,
      "sparse_tokens": 32121.0,
      "step": 619,
      "turn_loss": 0.08774228394031525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.028805054822523695,
      "grad_norm": 0.6572182178497314,
      "learning_rate": 9.956531196793745e-06,
      "loss": 0.215,
      "mae_dtheta": 0.010652502067387104,
      "mae_dx": 0.002782592084258795,
      "mae_dy": 0.0022149155847728252,
      "pose_mae_dtheta": 0.07569674402475357,
      "pose_mae_dx": 0.03519061580300331,
      "pose_mae_dy": 0.03176862373948097,
      "pose_rmse_dtheta": 0.17611554265022278,
      "pose_rmse_dx": 0.0943283662199974,
      "pose_rmse_dy": 0.0879037007689476,
      "pose_rmse_mean": 0.11944921314716339,
      "rmse_dtheta": 0.022908443585038185,
      "rmse_dx": 0.008689469657838345,
      "rmse_dy": 0.004974220413714647,
      "rmse_mean": 0.012190710753202438,
      "rotation_flip": 0.008150789886713028,
      "sparse_tokens": 32057.0,
      "step": 620,
      "turn_loss": 0.09449692815542221,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.028851514588366475,
      "grad_norm": 0.7442336082458496,
      "learning_rate": 9.956357052712347e-06,
      "loss": 0.174,
      "mae_dtheta": 0.020704783499240875,
      "mae_dx": 0.003355477936565876,
      "mae_dy": 0.005521225742995739,
      "pose_mae_dtheta": 0.14453954994678497,
      "pose_mae_dx": 0.046829525381326675,
      "pose_mae_dy": 0.05774976313114166,
      "pose_rmse_dtheta": 0.28749626874923706,
      "pose_rmse_dx": 0.10067237168550491,
      "pose_rmse_dy": 0.12458764761686325,
      "pose_rmse_mean": 0.1709187626838684,
      "rmse_dtheta": 0.03462912142276764,
      "rmse_dx": 0.00835033692419529,
      "rmse_dy": 0.010796047747135162,
      "rmse_mean": 0.017925169318914413,
      "rotation_flip": 0.011606022715568542,
      "sparse_tokens": 32121.0,
      "step": 621,
      "turn_loss": 0.1880575567483902,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.028897974354209256,
      "grad_norm": 0.5929259061813354,
      "learning_rate": 9.956182562030239e-06,
      "loss": 0.108,
      "mae_dtheta": 0.02759575843811035,
      "mae_dx": 0.01648746244609356,
      "mae_dy": 0.006143850274384022,
      "pose_mae_dtheta": 0.21223695576190948,
      "pose_mae_dx": 0.12914516031742096,
      "pose_mae_dy": 0.06224004924297333,
      "pose_rmse_dtheta": 0.3592917025089264,
      "pose_rmse_dx": 0.27641963958740234,
      "pose_rmse_dy": 0.11853747069835663,
      "pose_rmse_mean": 0.25141626596450806,
      "rmse_dtheta": 0.04192959517240524,
      "rmse_dx": 0.03004591353237629,
      "rmse_dy": 0.010505983605980873,
      "rmse_mean": 0.027493830770254135,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 7514.0,
      "step": 622,
      "turn_loss": 0.2782200872898102,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.028944434120052036,
      "grad_norm": 0.7174212336540222,
      "learning_rate": 9.956007724759625e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.04150086268782616,
      "mae_dx": 0.01983870007097721,
      "mae_dy": 0.012672029435634613,
      "pose_mae_dtheta": 0.3858868479728699,
      "pose_mae_dx": 0.17021821439266205,
      "pose_mae_dy": 0.12884362041950226,
      "pose_rmse_dtheta": 0.5568090081214905,
      "pose_rmse_dx": 0.3265109956264496,
      "pose_rmse_dy": 0.2485222965478897,
      "pose_rmse_mean": 0.3772807717323303,
      "rmse_dtheta": 0.057270511984825134,
      "rmse_dx": 0.03325231000781059,
      "rmse_dy": 0.021004831418395042,
      "rmse_mean": 0.03717588633298874,
      "rotation_flip": 0.014534884132444859,
      "sparse_tokens": 5729.0,
      "step": 623,
      "turn_loss": 0.46733179688453674,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.028990893885894816,
      "grad_norm": 0.37914708256721497,
      "learning_rate": 9.955832540912731e-06,
      "loss": 0.0936,
      "mae_dtheta": 0.007513522170484066,
      "mae_dx": 0.0017558721592649817,
      "mae_dy": 0.0007192789344117045,
      "pose_mae_dtheta": 0.05587032809853554,
      "pose_mae_dx": 0.014883617870509624,
      "pose_mae_dy": 0.010973756201565266,
      "pose_rmse_dtheta": 0.1722663789987564,
      "pose_rmse_dx": 0.03257887810468674,
      "pose_rmse_dy": 0.03878972679376602,
      "pose_rmse_mean": 0.08121165633201599,
      "rmse_dtheta": 0.023232487961649895,
      "rmse_dx": 0.004560462199151516,
      "rmse_dy": 0.0017508690943941474,
      "rmse_mean": 0.009847939945757389,
      "rotation_flip": 0.0010178117081522942,
      "sparse_tokens": 32217.0,
      "step": 624,
      "turn_loss": 0.05422481521964073,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.029037353651737596,
      "grad_norm": 0.6007214188575745,
      "learning_rate": 9.955657010501807e-06,
      "loss": 0.1758,
      "mae_dtheta": 0.03859955444931984,
      "mae_dx": 0.010810562409460545,
      "mae_dy": 0.004551429767161608,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6007213592529297,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 148.2067413330078,
      "model/head/act_norm_mean": 103.31637325802365,
      "model/head/act_norm_min": 61.537837982177734,
      "model/head/act_over_embed": 70.99997896603978,
      "model/head/grad_frac": 0.1103210300207138,
      "model/head/grad_norm": 0.06627219915390015,
      "model/head/grad_zero_frac": 0.00020495755597949028,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6635874155405406,
      "model/head/update_ratio": 0.0011585199972614646,
      "model/head/weight_delta": 2.803356170654297,
      "model/head/weight_delta_rel": 0.04917917028069496,
      "model/head/weight_norm": 57.20418930053711,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41045644879341125,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4104081471761068,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4103385806083679,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2820363210410309,
      "model/modality_embedder.encoders.pose/grad_frac": 0.15996825695037842,
      "model/modality_embedder.encoders.pose/grad_norm": 0.09609635174274445,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5258854166666667,
      "model/modality_embedder.encoders.pose/update_ratio": 0.003134697675704956,
      "model/modality_embedder.encoders.pose/weight_delta": 0.8080987334251404,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.02640310488641262,
      "model/modality_embedder.encoders.pose/weight_norm": 30.65570068359375,
      "model/modality_embedder/grad_frac": 0.15996825695037842,
      "model/modality_embedder/grad_norm": 0.09609635174274445,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5258854166666667,
      "model/modality_embedder/update_ratio": 0.003134697675704956,
      "model/modality_embedder/weight_delta": 0.8080987334251404,
      "model/modality_embedder/weight_delta_rel": 0.02640310488641262,
      "model/modality_embedder/weight_norm": 30.65570068359375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.29757690429688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.678417256542257,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.020496368408203,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.58482065738333,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08158167451620102,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.049007855355739594,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001782814390026033,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.3976413905620575,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.01449029240757227,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.48904037475586,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 71.7040786743164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.628339835371087,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.55493450164795,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.237616346869803,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07658601552248001,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04600685462355614,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015888221096247435,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.46525534987449646,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.016116809099912643,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.956581115722656,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 73.08233642578125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.3887983966109,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.022551536560059,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.447419951826525,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07614047825336456,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04573921114206314,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015309136360883713,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.475065141916275,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.015951797366142273,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.87706756591797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 73.20357513427734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.333683571964823,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.726836204528809,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.78396325263163,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07306597381830215,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04389229044318199,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014965353766456246,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.3979593813419342,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.01360036339610815,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.329269409179688,
      "model/normalizer/grad_frac": 0.30981817841529846,
      "model/normalizer/grad_norm": 0.18611440062522888,
      "model/normalizer/grad_zero_frac": 0.00023516594956163317,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002393981209024787,
      "model/normalizer/weight_delta": 0.8950743079185486,
      "model/normalizer/weight_delta_rel": 0.011528038419783115,
      "model/normalizer/weight_norm": 77.74263000488281,
      "pose_mae_dtheta": 0.3208502233028412,
      "pose_mae_dx": 0.0949496179819107,
      "pose_mae_dy": 0.04382944852113724,
      "pose_rmse_dtheta": 0.5706199407577515,
      "pose_rmse_dx": 0.20889060199260712,
      "pose_rmse_dy": 0.11648181825876236,
      "pose_rmse_mean": 0.2986641526222229,
      "rmse_dtheta": 0.05897652357816696,
      "rmse_dx": 0.021845074370503426,
      "rmse_dy": 0.011033168993890285,
      "rmse_mean": 0.030618255957961082,
      "rotation_flip": 0.018363939598202705,
      "sparse_tokens": 19022.0,
      "step": 625,
      "turn_loss": 0.2525475323200226,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.029083813417580377,
      "grad_norm": 0.48253437876701355,
      "learning_rate": 9.95548113353913e-06,
      "loss": 0.0909,
      "mae_dtheta": 0.011129071936011314,
      "mae_dx": 0.0028076365124434233,
      "mae_dy": 0.0022779793944209814,
      "pose_mae_dtheta": 0.07970143109560013,
      "pose_mae_dx": 0.03288336470723152,
      "pose_mae_dy": 0.03246250003576279,
      "pose_rmse_dtheta": 0.21161650121212006,
      "pose_rmse_dx": 0.1093841940164566,
      "pose_rmse_dy": 0.08530192077159882,
      "pose_rmse_mean": 0.13543421030044556,
      "rmse_dtheta": 0.025629928335547447,
      "rmse_dx": 0.010132381692528725,
      "rmse_dy": 0.005342540331184864,
      "rmse_mean": 0.013701616786420345,
      "rotation_flip": 0.006936416029930115,
      "sparse_tokens": 32057.0,
      "step": 626,
      "turn_loss": 0.07510904967784882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.029130273183423157,
      "grad_norm": 0.6023881435394287,
      "learning_rate": 9.955304910036993e-06,
      "loss": 0.0852,
      "mae_dtheta": 0.039974477142095566,
      "mae_dx": 0.018047265708446503,
      "mae_dy": 0.004155221860855818,
      "pose_mae_dtheta": 0.3252101540565491,
      "pose_mae_dx": 0.13986614346504211,
      "pose_mae_dy": 0.06451298296451569,
      "pose_rmse_dtheta": 0.5456060171127319,
      "pose_rmse_dx": 0.2773131728172302,
      "pose_rmse_dy": 0.14954084157943726,
      "pose_rmse_mean": 0.3241533637046814,
      "rmse_dtheta": 0.05725148320198059,
      "rmse_dx": 0.03166165202856064,
      "rmse_dy": 0.008266240358352661,
      "rmse_mean": 0.03239312767982483,
      "rotation_flip": 0.011784511618316174,
      "sparse_tokens": 9807.0,
      "step": 627,
      "turn_loss": 0.27935975790023804,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.029176732949265937,
      "grad_norm": 0.7788578271865845,
      "learning_rate": 9.95512834000773e-06,
      "loss": 0.1633,
      "mae_dtheta": 0.025688225403428078,
      "mae_dx": 0.004797757137566805,
      "mae_dy": 0.0028270313050597906,
      "pose_mae_dtheta": 0.21692177653312683,
      "pose_mae_dx": 0.042040031403303146,
      "pose_mae_dy": 0.04326070472598076,
      "pose_rmse_dtheta": 0.46691468358039856,
      "pose_rmse_dx": 0.11398900300264359,
      "pose_rmse_dy": 0.12353988736867905,
      "pose_rmse_mean": 0.23481452465057373,
      "rmse_dtheta": 0.047215692698955536,
      "rmse_dx": 0.013000564649701118,
      "rmse_dy": 0.0064206793904304504,
      "rmse_mean": 0.022212311625480652,
      "rotation_flip": 0.004291845485568047,
      "sparse_tokens": 16799.0,
      "step": 628,
      "turn_loss": 0.2076432704925537,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 2302.0,
      "epoch": 0.029223192715108717,
      "grad_norm": 0.45911890268325806,
      "learning_rate": 9.954951423463678e-06,
      "loss": 0.1084,
      "mae_dtheta": 0.03281397372484207,
      "mae_dx": 0.0345623679459095,
      "mae_dy": 0.013245741836726665,
      "pose_mae_dtheta": 0.23588335514068604,
      "pose_mae_dx": 0.21290722489356995,
      "pose_mae_dy": 0.2054680585861206,
      "pose_rmse_dtheta": 0.335256427526474,
      "pose_rmse_dx": 0.3584055006504059,
      "pose_rmse_dy": 0.3376128077507019,
      "pose_rmse_mean": 0.3437582850456238,
      "rmse_dtheta": 0.042651787400245667,
      "rmse_dx": 0.0461256243288517,
      "rmse_dy": 0.018147975206375122,
      "rmse_mean": 0.03564179688692093,
      "rotation_flip": 0.0396825410425663,
      "sparse_tokens": 2062.0,
      "step": 629,
      "turn_loss": 0.4569053649902344,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.029269652480951498,
      "grad_norm": 0.49250510334968567,
      "learning_rate": 9.954774160417216e-06,
      "loss": 0.1241,
      "mae_dtheta": 0.039005376398563385,
      "mae_dx": 0.012299703434109688,
      "mae_dy": 0.0032877165358513594,
      "pose_mae_dtheta": 0.29698070883750916,
      "pose_mae_dx": 0.08916018158197403,
      "pose_mae_dy": 0.03884657844901085,
      "pose_rmse_dtheta": 0.5360116958618164,
      "pose_rmse_dx": 0.21104590594768524,
      "pose_rmse_dy": 0.09055368602275848,
      "pose_rmse_mean": 0.27920377254486084,
      "rmse_dtheta": 0.05852586403489113,
      "rmse_dx": 0.025334756821393967,
      "rmse_dy": 0.0067214034497737885,
      "rmse_mean": 0.030194010585546494,
      "rotation_flip": 0.01649484597146511,
      "sparse_tokens": 8761.0,
      "step": 630,
      "turn_loss": 0.3142833709716797,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.029316112246794278,
      "grad_norm": 0.6902741193771362,
      "learning_rate": 9.954596550880735e-06,
      "loss": 0.109,
      "mae_dtheta": 0.012991007417440414,
      "mae_dx": 0.0026533533819019794,
      "mae_dy": 0.0023089756723493338,
      "pose_mae_dtheta": 0.08831404149532318,
      "pose_mae_dx": 0.029326703399419785,
      "pose_mae_dy": 0.029444023966789246,
      "pose_rmse_dtheta": 0.19810838997364044,
      "pose_rmse_dx": 0.07630915939807892,
      "pose_rmse_dy": 0.07151635736227036,
      "pose_rmse_mean": 0.11531130969524384,
      "rmse_dtheta": 0.027238719165325165,
      "rmse_dx": 0.008502684533596039,
      "rmse_dy": 0.004689749795943499,
      "rmse_mean": 0.013477051630616188,
      "rotation_flip": 0.006931776646524668,
      "sparse_tokens": 32137.0,
      "step": 631,
      "turn_loss": 0.1068340465426445,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2309.0,
      "epoch": 0.029362572012637055,
      "grad_norm": 0.6195061206817627,
      "learning_rate": 9.95441859486666e-06,
      "loss": 0.1182,
      "mae_dtheta": 0.02646671049296856,
      "mae_dx": 0.010444151237607002,
      "mae_dy": 0.00649236561730504,
      "pose_mae_dtheta": 0.17093265056610107,
      "pose_mae_dx": 0.0537012480199337,
      "pose_mae_dy": 0.08344985544681549,
      "pose_rmse_dtheta": 0.2741662561893463,
      "pose_rmse_dx": 0.1319045126438141,
      "pose_rmse_dy": 0.19440877437591553,
      "pose_rmse_mean": 0.20015984773635864,
      "rmse_dtheta": 0.03874042630195618,
      "rmse_dx": 0.023220568895339966,
      "rmse_dy": 0.010714488103985786,
      "rmse_mean": 0.024225160479545593,
      "rotation_flip": 0.0,
      "sparse_tokens": 2097.0,
      "step": 632,
      "turn_loss": 0.2326844036579132,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.029409031778479835,
      "grad_norm": 0.60833740234375,
      "learning_rate": 9.954240292387433e-06,
      "loss": 0.1179,
      "mae_dtheta": 0.03283647447824478,
      "mae_dx": 0.012211796827614307,
      "mae_dy": 0.0048369127325713634,
      "pose_mae_dtheta": 0.3090769052505493,
      "pose_mae_dx": 0.11184126883745193,
      "pose_mae_dy": 0.09052209556102753,
      "pose_rmse_dtheta": 0.4780038893222809,
      "pose_rmse_dx": 0.2521412968635559,
      "pose_rmse_dy": 0.26032984256744385,
      "pose_rmse_mean": 0.3301583528518677,
      "rmse_dtheta": 0.04895912855863571,
      "rmse_dx": 0.023982755839824677,
      "rmse_dy": 0.010969975031912327,
      "rmse_mean": 0.02797061949968338,
      "rotation_flip": 0.003759398590773344,
      "sparse_tokens": 5981.0,
      "step": 633,
      "turn_loss": 0.20857860147953033,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.029455491544322615,
      "grad_norm": 0.4454597234725952,
      "learning_rate": 9.954061643455524e-06,
      "loss": 0.0888,
      "mae_dtheta": 0.008481567725539207,
      "mae_dx": 0.0027303968090564013,
      "mae_dy": 0.00043321363045834005,
      "pose_mae_dtheta": 0.06561364233493805,
      "pose_mae_dx": 0.022895079106092453,
      "pose_mae_dy": 0.005691664759069681,
      "pose_rmse_dtheta": 0.2415751814842224,
      "pose_rmse_dx": 0.07354835420846939,
      "pose_rmse_dy": 0.012190005742013454,
      "pose_rmse_mean": 0.10910451412200928,
      "rmse_dtheta": 0.028066305443644524,
      "rmse_dx": 0.008835576474666595,
      "rmse_dy": 0.0012625287054106593,
      "rmse_mean": 0.012721470557153225,
      "rotation_flip": 0.006472492124885321,
      "sparse_tokens": 32121.0,
      "step": 634,
      "turn_loss": 0.0671890452504158,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64681.0,
      "epoch": 0.029501951310165395,
      "grad_norm": 0.6080442070960999,
      "learning_rate": 9.953882648083425e-06,
      "loss": 0.1054,
      "mae_dtheta": 0.011960168369114399,
      "mae_dx": 0.0024623307399451733,
      "mae_dy": 0.00031750250491313636,
      "pose_mae_dtheta": 0.09000786393880844,
      "pose_mae_dx": 0.019677378237247467,
      "pose_mae_dy": 0.004453074652701616,
      "pose_rmse_dtheta": 0.32633882761001587,
      "pose_rmse_dx": 0.042138393968343735,
      "pose_rmse_dy": 0.009001731872558594,
      "pose_rmse_mean": 0.12582632899284363,
      "rmse_dtheta": 0.036522869020700455,
      "rmse_dx": 0.006003076210618019,
      "rmse_dy": 0.000537992746103555,
      "rmse_mean": 0.0143546462059021,
      "rotation_flip": 0.003544303821399808,
      "sparse_tokens": 32281.0,
      "step": 635,
      "turn_loss": 0.06933075189590454,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.029548411076008176,
      "grad_norm": 0.39529991149902344,
      "learning_rate": 9.953703306283654e-06,
      "loss": 0.1435,
      "mae_dtheta": 0.01067804079502821,
      "mae_dx": 0.0023320773616433144,
      "mae_dy": 0.001917554996907711,
      "pose_mae_dtheta": 0.07527700066566467,
      "pose_mae_dx": 0.023962456732988358,
      "pose_mae_dy": 0.027623377740383148,
      "pose_rmse_dtheta": 0.17021380364894867,
      "pose_rmse_dx": 0.05535378307104111,
      "pose_rmse_dy": 0.06519566476345062,
      "pose_rmse_mean": 0.09692108631134033,
      "rmse_dtheta": 0.02217361330986023,
      "rmse_dx": 0.006530134007334709,
      "rmse_dy": 0.003779774997383356,
      "rmse_mean": 0.010827841237187386,
      "rotation_flip": 0.0045854030176997185,
      "sparse_tokens": 32185.0,
      "step": 636,
      "turn_loss": 0.08473294228315353,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.029594870841850956,
      "grad_norm": 0.6134403347969055,
      "learning_rate": 9.95352361806875e-06,
      "loss": 0.1557,
      "mae_dtheta": 0.012199996039271355,
      "mae_dx": 0.0020684690680354834,
      "mae_dy": 0.0029949028976261616,
      "pose_mae_dtheta": 0.08720068633556366,
      "pose_mae_dx": 0.026345664635300636,
      "pose_mae_dy": 0.03495574742555618,
      "pose_rmse_dtheta": 0.22030773758888245,
      "pose_rmse_dx": 0.06351623684167862,
      "pose_rmse_dy": 0.0777403712272644,
      "pose_rmse_mean": 0.12052144855260849,
      "rmse_dtheta": 0.025871800258755684,
      "rmse_dx": 0.006711184978485107,
      "rmse_dy": 0.007118155714124441,
      "rmse_mean": 0.013233712874352932,
      "rotation_flip": 0.004515599459409714,
      "sparse_tokens": 32057.0,
      "step": 637,
      "turn_loss": 0.10271167010068893,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.029641330607693736,
      "grad_norm": 0.659688413143158,
      "learning_rate": 9.95334358345128e-06,
      "loss": 0.2125,
      "mae_dtheta": 0.038873519748449326,
      "mae_dx": 0.015236085280776024,
      "mae_dy": 0.008810050785541534,
      "pose_mae_dtheta": 0.3259059488773346,
      "pose_mae_dx": 0.1287260502576828,
      "pose_mae_dy": 0.1031624972820282,
      "pose_rmse_dtheta": 0.5191405415534973,
      "pose_rmse_dx": 0.2521060109138489,
      "pose_rmse_dy": 0.22228994965553284,
      "pose_rmse_mean": 0.33117884397506714,
      "rmse_dtheta": 0.056419190019369125,
      "rmse_dx": 0.027947984635829926,
      "rmse_dy": 0.016049066558480263,
      "rmse_mean": 0.033472079783678055,
      "rotation_flip": 0.016587678343057632,
      "sparse_tokens": 13488.0,
      "step": 638,
      "turn_loss": 0.34579765796661377,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.029687790373536516,
      "grad_norm": 0.6789276599884033,
      "learning_rate": 9.953163202443838e-06,
      "loss": 0.1506,
      "mae_dtheta": 0.041150934994220734,
      "mae_dx": 0.012673546560108662,
      "mae_dy": 0.005691921338438988,
      "pose_mae_dtheta": 0.3477485477924347,
      "pose_mae_dx": 0.10248038917779922,
      "pose_mae_dy": 0.07442156225442886,
      "pose_rmse_dtheta": 0.5574698448181152,
      "pose_rmse_dx": 0.2190609872341156,
      "pose_rmse_dy": 0.19620029628276825,
      "pose_rmse_mean": 0.3242437243461609,
      "rmse_dtheta": 0.05827777087688446,
      "rmse_dx": 0.02511492185294628,
      "rmse_dy": 0.012990811839699745,
      "rmse_mean": 0.03212783485651016,
      "rotation_flip": 0.01157742366194725,
      "sparse_tokens": 21891.0,
      "step": 639,
      "turn_loss": 0.3293960690498352,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.029734250139379297,
      "grad_norm": 0.7328382134437561,
      "learning_rate": 9.952982475059032e-06,
      "loss": 0.1355,
      "mae_dtheta": 0.012468608096241951,
      "mae_dx": 0.0018769950838759542,
      "mae_dy": 0.002785193268209696,
      "pose_mae_dtheta": 0.09175041317939758,
      "pose_mae_dx": 0.029558349400758743,
      "pose_mae_dy": 0.034022293984889984,
      "pose_rmse_dtheta": 0.24631470441818237,
      "pose_rmse_dx": 0.08618398010730743,
      "pose_rmse_dy": 0.08370978385210037,
      "pose_rmse_mean": 0.13873615860939026,
      "rmse_dtheta": 0.028191929683089256,
      "rmse_dx": 0.005471362266689539,
      "rmse_dy": 0.006439013872295618,
      "rmse_mean": 0.01336743589490652,
      "rotation_flip": 0.0032428051345050335,
      "sparse_tokens": 32073.0,
      "step": 640,
      "turn_loss": 0.0833551213145256,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.029780709905222077,
      "grad_norm": 0.5346888899803162,
      "learning_rate": 9.952801401309504e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.012638291344046593,
      "mae_dx": 0.001801674603484571,
      "mae_dy": 0.00260037649422884,
      "pose_mae_dtheta": 0.0917440727353096,
      "pose_mae_dx": 0.028584139421582222,
      "pose_mae_dy": 0.03606901317834854,
      "pose_rmse_dtheta": 0.21994271874427795,
      "pose_rmse_dx": 0.07549650222063065,
      "pose_rmse_dy": 0.07506942003965378,
      "pose_rmse_mean": 0.12350288033485413,
      "rmse_dtheta": 0.025227779522538185,
      "rmse_dx": 0.005147056188434362,
      "rmse_dy": 0.00507912365719676,
      "rmse_mean": 0.011817987076938152,
      "rotation_flip": 0.001522649428807199,
      "sparse_tokens": 32073.0,
      "step": 641,
      "turn_loss": 0.09218834340572357,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.029827169671064857,
      "grad_norm": 0.7779186367988586,
      "learning_rate": 9.952619981207917e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.008307989686727524,
      "mae_dx": 0.0031827674247324467,
      "mae_dy": 0.00038349087117239833,
      "pose_mae_dtheta": 0.06727664172649384,
      "pose_mae_dx": 0.02584482729434967,
      "pose_mae_dy": 0.007465551141649485,
      "pose_rmse_dtheta": 0.23092128336429596,
      "pose_rmse_dx": 0.07600600272417068,
      "pose_rmse_dy": 0.014919333159923553,
      "pose_rmse_mean": 0.10728221386671066,
      "rmse_dtheta": 0.026540955528616905,
      "rmse_dx": 0.009312836453318596,
      "rmse_dy": 0.0006465342594310641,
      "rmse_mean": 0.01216677576303482,
      "rotation_flip": 0.004608294926583767,
      "sparse_tokens": 32153.0,
      "step": 642,
      "turn_loss": 0.05647650733590126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.029873629436907637,
      "grad_norm": 0.6090490221977234,
      "learning_rate": 9.952438214766956e-06,
      "loss": 0.1751,
      "mae_dtheta": 0.03358697146177292,
      "mae_dx": 0.012479309923946857,
      "mae_dy": 0.003469148650765419,
      "pose_mae_dtheta": 0.2787434458732605,
      "pose_mae_dx": 0.07453460991382599,
      "pose_mae_dy": 0.05383344739675522,
      "pose_rmse_dtheta": 0.4708290100097656,
      "pose_rmse_dx": 0.18558529019355774,
      "pose_rmse_dy": 0.12779280543327332,
      "pose_rmse_mean": 0.2614023685455322,
      "rmse_dtheta": 0.05157497152686119,
      "rmse_dx": 0.02560470998287201,
      "rmse_dy": 0.00636932160705328,
      "rmse_mean": 0.027849670499563217,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 7265.0,
      "step": 643,
      "turn_loss": 0.25389882922172546,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.029920089202750418,
      "grad_norm": 0.42894402146339417,
      "learning_rate": 9.95225610199933e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.035128213465213776,
      "mae_dx": 0.010351946577429771,
      "mae_dy": 0.007282691542059183,
      "pose_mae_dtheta": 0.239383727312088,
      "pose_mae_dx": 0.08637367933988571,
      "pose_mae_dy": 0.08284265547990799,
      "pose_rmse_dtheta": 0.3892503082752228,
      "pose_rmse_dx": 0.16887050867080688,
      "pose_rmse_dy": 0.17487867176532745,
      "pose_rmse_mean": 0.2443331778049469,
      "rmse_dtheta": 0.05025796219706535,
      "rmse_dx": 0.021247318014502525,
      "rmse_dy": 0.012553578242659569,
      "rmse_mean": 0.0280196201056242,
      "rotation_flip": 0.0182232353836298,
      "sparse_tokens": 7411.0,
      "step": 644,
      "turn_loss": 0.3004308342933655,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.029966548968593198,
      "grad_norm": 0.8442609310150146,
      "learning_rate": 9.952073642917779e-06,
      "loss": 0.2195,
      "mae_dtheta": 0.011601000092923641,
      "mae_dx": 0.0023960948456078768,
      "mae_dy": 0.0013118765782564878,
      "pose_mae_dtheta": 0.08655726909637451,
      "pose_mae_dx": 0.01926887221634388,
      "pose_mae_dy": 0.017518840730190277,
      "pose_rmse_dtheta": 0.2555015981197357,
      "pose_rmse_dx": 0.051973894238471985,
      "pose_rmse_dy": 0.04918825253844261,
      "pose_rmse_mean": 0.11888792365789413,
      "rmse_dtheta": 0.03125960752367973,
      "rmse_dx": 0.007452328689396381,
      "rmse_dy": 0.004541657865047455,
      "rmse_mean": 0.014417864382266998,
      "rotation_flip": 0.0050156740471720695,
      "sparse_tokens": 32121.0,
      "step": 645,
      "turn_loss": 0.08637616038322449,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.030013008734435978,
      "grad_norm": 0.6648939251899719,
      "learning_rate": 9.951890837535058e-06,
      "loss": 0.165,
      "mae_dtheta": 0.031191477552056313,
      "mae_dx": 0.012061834335327148,
      "mae_dy": 0.005102485418319702,
      "pose_mae_dtheta": 0.2549184560775757,
      "pose_mae_dx": 0.09220805764198303,
      "pose_mae_dy": 0.0928066074848175,
      "pose_rmse_dtheta": 0.4895258843898773,
      "pose_rmse_dx": 0.22073949873447418,
      "pose_rmse_dy": 0.18679659068584442,
      "pose_rmse_mean": 0.2990206778049469,
      "rmse_dtheta": 0.050289593636989594,
      "rmse_dx": 0.025381427258253098,
      "rmse_dy": 0.009528539143502712,
      "rmse_mean": 0.02839985303580761,
      "rotation_flip": 0.02244389057159424,
      "sparse_tokens": 8877.0,
      "step": 646,
      "turn_loss": 0.22226794064044952,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.03005946850027876,
      "grad_norm": 0.8920131325721741,
      "learning_rate": 9.951707685863956e-06,
      "loss": 0.1671,
      "mae_dtheta": 0.01145034097135067,
      "mae_dx": 0.004245859570801258,
      "mae_dy": 0.003531655529513955,
      "pose_mae_dtheta": 0.08556436747312546,
      "pose_mae_dx": 0.043662749230861664,
      "pose_mae_dy": 0.04623271897435188,
      "pose_rmse_dtheta": 0.23320750892162323,
      "pose_rmse_dx": 0.12190361320972443,
      "pose_rmse_dy": 0.1951589733362198,
      "pose_rmse_mean": 0.18342337012290955,
      "rmse_dtheta": 0.026855511590838432,
      "rmse_dx": 0.013170632533729076,
      "rmse_dy": 0.013009452261030674,
      "rmse_mean": 0.017678532749414444,
      "rotation_flip": 0.005284791346639395,
      "sparse_tokens": 32057.0,
      "step": 647,
      "turn_loss": 0.11703498661518097,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.03010592826612154,
      "grad_norm": 0.42363712191581726,
      "learning_rate": 9.951524187917277e-06,
      "loss": 0.1072,
      "mae_dtheta": 0.011632253415882587,
      "mae_dx": 0.0023386841639876366,
      "mae_dy": 0.0022675797808915377,
      "pose_mae_dtheta": 0.08221016079187393,
      "pose_mae_dx": 0.027978654950857162,
      "pose_mae_dy": 0.02448250725865364,
      "pose_rmse_dtheta": 0.22525084018707275,
      "pose_rmse_dx": 0.0798654779791832,
      "pose_rmse_dy": 0.06529467552900314,
      "pose_rmse_mean": 0.12347033619880676,
      "rmse_dtheta": 0.02802710421383381,
      "rmse_dx": 0.007469775155186653,
      "rmse_dy": 0.0059781488962471485,
      "rmse_mean": 0.0138250095769763,
      "rotation_flip": 0.009925558231770992,
      "sparse_tokens": 32089.0,
      "step": 648,
      "turn_loss": 0.08811993151903152,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.03015238803196432,
      "grad_norm": 0.5131062269210815,
      "learning_rate": 9.951340343707852e-06,
      "loss": 0.13,
      "mae_dtheta": 0.032720692455768585,
      "mae_dx": 0.014009498991072178,
      "mae_dy": 0.007932206615805626,
      "pose_mae_dtheta": 0.23544703423976898,
      "pose_mae_dx": 0.09653452783823013,
      "pose_mae_dy": 0.1033134013414383,
      "pose_rmse_dtheta": 0.35595932602882385,
      "pose_rmse_dx": 0.1924673318862915,
      "pose_rmse_dy": 0.18003548681735992,
      "pose_rmse_mean": 0.24282070994377136,
      "rmse_dtheta": 0.046052563935518265,
      "rmse_dx": 0.02671099826693535,
      "rmse_dy": 0.011690320447087288,
      "rmse_mean": 0.028151294216513634,
      "rotation_flip": 0.02102496661245823,
      "sparse_tokens": 13425.0,
      "step": 649,
      "turn_loss": 0.30048051476478577,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.0301988477978071,
      "grad_norm": 0.5256068110466003,
      "learning_rate": 9.95115615324854e-06,
      "loss": 0.125,
      "mae_dtheta": 0.0406729094684124,
      "mae_dx": 0.008270664140582085,
      "mae_dy": 0.004774890840053558,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5256067514419556,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 148.80430603027344,
      "model/head/act_norm_mean": 104.88109691722973,
      "model/head/act_norm_min": 66.08505249023438,
      "model/head/act_over_embed": 72.07527171381989,
      "model/head/grad_frac": 0.08430564403533936,
      "model/head/grad_norm": 0.04431161656975746,
      "model/head/grad_zero_frac": 0.0002011503092944622,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6683382601351351,
      "model/head/update_ratio": 0.0007745292969048023,
      "model/head/weight_delta": 2.8551294803619385,
      "model/head/weight_delta_rel": 0.05008742958307266,
      "model/head/weight_norm": 57.211029052734375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41060003638267517,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41054986652575043,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41048872470855713,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28213371190490344,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12098348885774612,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06358973681926727,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5321751644736842,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0020741941407322884,
      "model/modality_embedder.encoders.pose/weight_delta": 0.8357465267181396,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.027306443080306053,
      "model/modality_embedder.encoders.pose/weight_norm": 30.657562255859375,
      "model/modality_embedder/grad_frac": 0.12098348885774612,
      "model/modality_embedder/grad_norm": 0.06358973681926727,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5321751644736842,
      "model/modality_embedder/update_ratio": 0.0020741941407322884,
      "model/modality_embedder/weight_delta": 0.8357465267181396,
      "model/modality_embedder/weight_delta_rel": 0.027306443080306053,
      "model/modality_embedder/weight_norm": 30.657562255859375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.69145202636719,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.842531705812956,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.149523735046387,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.697601643385836,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06691434234380722,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03517062962055206,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012793316273018718,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.4089922606945038,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.01490392442792654,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.491409301757812,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.41809844970703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.78758781102531,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.660126686096191,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.347053046642422,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06608613580465317,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03473531827330589,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011993732769042253,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.47931936383247375,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.016603996977210045,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.961223602294922,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.24980926513672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.54681132024882,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.853452682495117,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.556007912290802,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0671943798661232,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03531781956553459,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001181970932520926,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.49029093980789185,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.016463052481412888,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.88044548034668,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.21685791015625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.529828936078935,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.635345458984375,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.918756183192677,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07228922098875046,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.037995703518390656,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012954163830727339,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.4115369915962219,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.014064381830394268,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.330881118774414,
      "model/normalizer/grad_frac": 0.28471165895462036,
      "model/normalizer/grad_norm": 0.14964637160301208,
      "model/normalizer/grad_zero_frac": 0.00023162072466220707,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0019247903255745769,
      "model/normalizer/weight_delta": 0.9230235815048218,
      "model/normalizer/weight_delta_rel": 0.011888009496033192,
      "model/normalizer/weight_norm": 77.74684143066406,
      "pose_mae_dtheta": 0.3185250759124756,
      "pose_mae_dx": 0.0641811266541481,
      "pose_mae_dy": 0.056898828595876694,
      "pose_rmse_dtheta": 0.5168938636779785,
      "pose_rmse_dx": 0.12883774936199188,
      "pose_rmse_dy": 0.13886505365371704,
      "pose_rmse_mean": 0.2615322470664978,
      "rmse_dtheta": 0.06020551919937134,
      "rmse_dx": 0.017723821103572845,
      "rmse_dy": 0.009928278625011444,
      "rmse_mean": 0.029285874217748642,
      "rotation_flip": 0.012269938364624977,
      "sparse_tokens": 9403.0,
      "step": 650,
      "turn_loss": 0.24436470866203308,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.03024530756364988,
      "grad_norm": 0.38857796788215637,
      "learning_rate": 9.950971616552222e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.013907046057283878,
      "mae_dx": 0.003395727137103677,
      "mae_dy": 0.0035173275973647833,
      "pose_mae_dtheta": 0.10609807819128036,
      "pose_mae_dx": 0.03333597630262375,
      "pose_mae_dy": 0.045012783259153366,
      "pose_rmse_dtheta": 0.24949601292610168,
      "pose_rmse_dx": 0.09166328608989716,
      "pose_rmse_dy": 0.1184864193201065,
      "pose_rmse_mean": 0.153215229511261,
      "rmse_dtheta": 0.029072914272546768,
      "rmse_dx": 0.01101042702794075,
      "rmse_dy": 0.00955007690936327,
      "rmse_mean": 0.01654447242617607,
      "rotation_flip": 0.006530612241476774,
      "sparse_tokens": 32105.0,
      "step": 651,
      "turn_loss": 0.11065804958343506,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.03029176732949266,
      "grad_norm": 0.8673513531684875,
      "learning_rate": 9.950786733631802e-06,
      "loss": 0.1582,
      "mae_dtheta": 0.03885909914970398,
      "mae_dx": 0.012158744037151337,
      "mae_dy": 0.007279437966644764,
      "pose_mae_dtheta": 0.346576452255249,
      "pose_mae_dx": 0.09383468329906464,
      "pose_mae_dy": 0.06643140316009521,
      "pose_rmse_dtheta": 0.5638818740844727,
      "pose_rmse_dx": 0.20982521772384644,
      "pose_rmse_dy": 0.20830896496772766,
      "pose_rmse_mean": 0.32733869552612305,
      "rmse_dtheta": 0.05612080916762352,
      "rmse_dx": 0.023639708757400513,
      "rmse_dy": 0.01554186549037695,
      "rmse_mean": 0.03176746517419815,
      "rotation_flip": 0.009302325546741486,
      "sparse_tokens": 9795.0,
      "step": 652,
      "turn_loss": 0.38926807045936584,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.03033822709533544,
      "grad_norm": 0.5112958550453186,
      "learning_rate": 9.950601504500206e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.008778317831456661,
      "mae_dx": 0.0014889354351907969,
      "mae_dy": 0.0019231106853112578,
      "pose_mae_dtheta": 0.06334089487791061,
      "pose_mae_dx": 0.02188831754028797,
      "pose_mae_dy": 0.02982506901025772,
      "pose_rmse_dtheta": 0.12982375919818878,
      "pose_rmse_dx": 0.060960981994867325,
      "pose_rmse_dy": 0.07077675312757492,
      "pose_rmse_mean": 0.08718716353178024,
      "rmse_dtheta": 0.017485208809375763,
      "rmse_dx": 0.004984659608453512,
      "rmse_dy": 0.004118464887142181,
      "rmse_mean": 0.008862778544425964,
      "rotation_flip": 0.004189944360405207,
      "sparse_tokens": 32057.0,
      "step": 653,
      "turn_loss": 0.06269495189189911,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.03038468686117822,
      "grad_norm": 0.4008080065250397,
      "learning_rate": 9.950415929170391e-06,
      "loss": 0.1241,
      "mae_dtheta": 0.010937240906059742,
      "mae_dx": 0.002245527459308505,
      "mae_dy": 0.0024545046035200357,
      "pose_mae_dtheta": 0.0772324800491333,
      "pose_mae_dx": 0.023545963689684868,
      "pose_mae_dy": 0.028661178424954414,
      "pose_rmse_dtheta": 0.20589347183704376,
      "pose_rmse_dx": 0.06035584583878517,
      "pose_rmse_dy": 0.06881193816661835,
      "pose_rmse_mean": 0.1116870865225792,
      "rmse_dtheta": 0.02658134512603283,
      "rmse_dx": 0.006817181129008532,
      "rmse_dy": 0.006340804509818554,
      "rmse_mean": 0.0132464449852705,
      "rotation_flip": 0.007070260588079691,
      "sparse_tokens": 32105.0,
      "step": 654,
      "turn_loss": 0.08264243602752686,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18833.0,
      "epoch": 0.030431146627021,
      "grad_norm": 0.5284306406974792,
      "learning_rate": 9.950230007655333e-06,
      "loss": 0.1357,
      "mae_dtheta": 0.043356746435165405,
      "mae_dx": 0.014867817051708698,
      "mae_dy": 0.0052712042815983295,
      "pose_mae_dtheta": 0.3534667193889618,
      "pose_mae_dx": 0.115139901638031,
      "pose_mae_dy": 0.05386665090918541,
      "pose_rmse_dtheta": 0.5743690729141235,
      "pose_rmse_dx": 0.24413719773292542,
      "pose_rmse_dy": 0.12142284214496613,
      "pose_rmse_mean": 0.3133096992969513,
      "rmse_dtheta": 0.06089909374713898,
      "rmse_dx": 0.02700217254459858,
      "rmse_dy": 0.01180178765207529,
      "rmse_mean": 0.03323435038328171,
      "rotation_flip": 0.013144590891897678,
      "sparse_tokens": 14205.0,
      "step": 655,
      "turn_loss": 0.36064425110816956,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.03047760639286378,
      "grad_norm": 0.5844431519508362,
      "learning_rate": 9.950043739968032e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.016346078366041183,
      "mae_dx": 0.0023790793493390083,
      "mae_dy": 0.003918210044503212,
      "pose_mae_dtheta": 0.11636385321617126,
      "pose_mae_dx": 0.03987441211938858,
      "pose_mae_dy": 0.04790419340133667,
      "pose_rmse_dtheta": 0.24365229904651642,
      "pose_rmse_dx": 0.09035585820674896,
      "pose_rmse_dy": 0.10833080112934113,
      "pose_rmse_mean": 0.14744631946086884,
      "rmse_dtheta": 0.029465708881616592,
      "rmse_dx": 0.006135461386293173,
      "rmse_dy": 0.0077207451686263084,
      "rmse_mean": 0.014440638944506645,
      "rotation_flip": 0.006239737384021282,
      "sparse_tokens": 32105.0,
      "step": 656,
      "turn_loss": 0.11657639592885971,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.03052406615870656,
      "grad_norm": 0.8782687187194824,
      "learning_rate": 9.949857126121519e-06,
      "loss": 0.1688,
      "mae_dtheta": 0.030155809596180916,
      "mae_dx": 0.01612688973546028,
      "mae_dy": 0.004559147171676159,
      "pose_mae_dtheta": 0.21513602137565613,
      "pose_mae_dx": 0.12486271560192108,
      "pose_mae_dy": 0.06391897052526474,
      "pose_rmse_dtheta": 0.38943877816200256,
      "pose_rmse_dx": 0.272468626499176,
      "pose_rmse_dy": 0.13894055783748627,
      "pose_rmse_mean": 0.2669493556022644,
      "rmse_dtheta": 0.04757010564208031,
      "rmse_dx": 0.02955552563071251,
      "rmse_dy": 0.009244473651051521,
      "rmse_mean": 0.028790034353733063,
      "rotation_flip": 0.01093294471502304,
      "sparse_tokens": 23382.0,
      "step": 657,
      "turn_loss": 0.2763137221336365,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.03057052592454934,
      "grad_norm": 0.4710380434989929,
      "learning_rate": 9.949670166128838e-06,
      "loss": 0.1407,
      "mae_dtheta": 0.038968510925769806,
      "mae_dx": 0.008376337587833405,
      "mae_dy": 0.006115771364420652,
      "pose_mae_dtheta": 0.27381205558776855,
      "pose_mae_dx": 0.07567456364631653,
      "pose_mae_dy": 0.06485665589570999,
      "pose_rmse_dtheta": 0.48983263969421387,
      "pose_rmse_dx": 0.1861407458782196,
      "pose_rmse_dy": 0.14155226945877075,
      "pose_rmse_mean": 0.27250856161117554,
      "rmse_dtheta": 0.057602643966674805,
      "rmse_dx": 0.019489673897624016,
      "rmse_dy": 0.011011076159775257,
      "rmse_mean": 0.029367800801992416,
      "rotation_flip": 0.016011644154787064,
      "sparse_tokens": 11133.0,
      "step": 658,
      "turn_loss": 0.27457985281944275,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.03061698569039212,
      "grad_norm": 0.3893200159072876,
      "learning_rate": 9.949482860003066e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.011367962695658207,
      "mae_dx": 0.0028257491067051888,
      "mae_dy": 0.003288096049800515,
      "pose_mae_dtheta": 0.07734382152557373,
      "pose_mae_dx": 0.030140211805701256,
      "pose_mae_dy": 0.033485833555459976,
      "pose_rmse_dtheta": 0.19153159856796265,
      "pose_rmse_dx": 0.08552771806716919,
      "pose_rmse_dy": 0.07142489403486252,
      "pose_rmse_mean": 0.11616140604019165,
      "rmse_dtheta": 0.024095121771097183,
      "rmse_dx": 0.008762844838202,
      "rmse_dy": 0.007949949242174625,
      "rmse_mean": 0.013602638617157936,
      "rotation_flip": 0.005261179991066456,
      "sparse_tokens": 32105.0,
      "step": 659,
      "turn_loss": 0.10332683473825455,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32115.0,
      "epoch": 0.0306634454562349,
      "grad_norm": 0.49646294116973877,
      "learning_rate": 9.9492952077573e-06,
      "loss": 0.1241,
      "mae_dtheta": 0.028394170105457306,
      "mae_dx": 0.010787679813802242,
      "mae_dy": 0.0035303805489093065,
      "pose_mae_dtheta": 0.22084537148475647,
      "pose_mae_dx": 0.08557939529418945,
      "pose_mae_dy": 0.04687386751174927,
      "pose_rmse_dtheta": 0.39618828892707825,
      "pose_rmse_dx": 0.20795881748199463,
      "pose_rmse_dy": 0.11583998054265976,
      "pose_rmse_mean": 0.23999568819999695,
      "rmse_dtheta": 0.04525509849190712,
      "rmse_dx": 0.023462694138288498,
      "rmse_dy": 0.006902331952005625,
      "rmse_mean": 0.025206707417964935,
      "rotation_flip": 0.007501875516027212,
      "sparse_tokens": 26160.0,
      "step": 660,
      "turn_loss": 0.23041455447673798,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.030709905222077682,
      "grad_norm": 0.5612654089927673,
      "learning_rate": 9.949107209404664e-06,
      "loss": 0.173,
      "mae_dtheta": 0.012539553456008434,
      "mae_dx": 0.003304846119135618,
      "mae_dy": 0.0035650301724672318,
      "pose_mae_dtheta": 0.09056226164102554,
      "pose_mae_dx": 0.03560497984290123,
      "pose_mae_dy": 0.034743063151836395,
      "pose_rmse_dtheta": 0.24761222302913666,
      "pose_rmse_dx": 0.10365229099988937,
      "pose_rmse_dy": 0.093023382127285,
      "pose_rmse_mean": 0.148095965385437,
      "rmse_dtheta": 0.028463536873459816,
      "rmse_dx": 0.009262324310839176,
      "rmse_dy": 0.009126950055360794,
      "rmse_mean": 0.015617604367434978,
      "rotation_flip": 0.004070003982633352,
      "sparse_tokens": 32105.0,
      "step": 661,
      "turn_loss": 0.12275763601064682,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.030756364987920462,
      "grad_norm": 0.8603866100311279,
      "learning_rate": 9.948918864958306e-06,
      "loss": 0.1636,
      "mae_dtheta": 0.025190720334649086,
      "mae_dx": 0.007904237136244774,
      "mae_dy": 0.0030517461709678173,
      "pose_mae_dtheta": 0.21034136414527893,
      "pose_mae_dx": 0.06487404555082321,
      "pose_mae_dy": 0.047109659761190414,
      "pose_rmse_dtheta": 0.4358648359775543,
      "pose_rmse_dx": 0.18728739023208618,
      "pose_rmse_dy": 0.1382264494895935,
      "pose_rmse_mean": 0.2537929117679596,
      "rmse_dtheta": 0.04613875970244408,
      "rmse_dx": 0.019987421110272408,
      "rmse_dy": 0.00668232562020421,
      "rmse_mean": 0.024269504472613335,
      "rotation_flip": 0.008486563339829445,
      "sparse_tokens": 16074.0,
      "step": 662,
      "turn_loss": 0.16815528273582458,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.030802824753763242,
      "grad_norm": 0.5228360295295715,
      "learning_rate": 9.948730174431393e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.01365415658801794,
      "mae_dx": 0.0021881319116801023,
      "mae_dy": 0.0026481891982257366,
      "pose_mae_dtheta": 0.09654650092124939,
      "pose_mae_dx": 0.031552113592624664,
      "pose_mae_dy": 0.03434254974126816,
      "pose_rmse_dtheta": 0.2662510275840759,
      "pose_rmse_dx": 0.07648713141679764,
      "pose_rmse_dy": 0.07653595507144928,
      "pose_rmse_mean": 0.13975803554058075,
      "rmse_dtheta": 0.03020617738366127,
      "rmse_dx": 0.006457382347434759,
      "rmse_dy": 0.005466139875352383,
      "rmse_mean": 0.0140432333573699,
      "rotation_flip": 0.004870129749178886,
      "sparse_tokens": 32089.0,
      "step": 663,
      "turn_loss": 0.09178303927183151,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2309.0,
      "epoch": 0.030849284519606023,
      "grad_norm": 0.6061538457870483,
      "learning_rate": 9.948541137837126e-06,
      "loss": 0.1855,
      "mae_dtheta": 0.03663815185427666,
      "mae_dx": 0.011787411756813526,
      "mae_dy": 0.005943743046373129,
      "pose_mae_dtheta": 0.2346370369195938,
      "pose_mae_dx": 0.09982338547706604,
      "pose_mae_dy": 0.023893287405371666,
      "pose_rmse_dtheta": 0.3773046135902405,
      "pose_rmse_dx": 0.17210596799850464,
      "pose_rmse_dy": 0.03367428854107857,
      "pose_rmse_mean": 0.1943616271018982,
      "rmse_dtheta": 0.05146265774965286,
      "rmse_dx": 0.01981375552713871,
      "rmse_dy": 0.009713982231914997,
      "rmse_mean": 0.026996798813343048,
      "rotation_flip": 0.00917431153357029,
      "sparse_tokens": 1948.0,
      "step": 664,
      "turn_loss": 0.4180662930011749,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.030895744285448803,
      "grad_norm": 0.46915140748023987,
      "learning_rate": 9.948351755188718e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.012880428694188595,
      "mae_dx": 0.002225211588665843,
      "mae_dy": 0.0026618330739438534,
      "pose_mae_dtheta": 0.08616523444652557,
      "pose_mae_dx": 0.030380111187696457,
      "pose_mae_dy": 0.03460223972797394,
      "pose_rmse_dtheta": 0.19146405160427094,
      "pose_rmse_dx": 0.07113644480705261,
      "pose_rmse_dy": 0.08568087965250015,
      "pose_rmse_mean": 0.11609378457069397,
      "rmse_dtheta": 0.027226321399211884,
      "rmse_dx": 0.006032684352248907,
      "rmse_dy": 0.0055450680665671825,
      "rmse_mean": 0.012934691272675991,
      "rotation_flip": 0.0033003301359713078,
      "sparse_tokens": 32137.0,
      "step": 665,
      "turn_loss": 0.09693021327257156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16887.0,
      "epoch": 0.030942204051291583,
      "grad_norm": 0.5180729031562805,
      "learning_rate": 9.948162026499419e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.03785722330212593,
      "mae_dx": 0.012972894124686718,
      "mae_dy": 0.0073299165815114975,
      "pose_mae_dtheta": 0.29616591334342957,
      "pose_mae_dx": 0.10590537637472153,
      "pose_mae_dy": 0.07684260606765747,
      "pose_rmse_dtheta": 0.5309093594551086,
      "pose_rmse_dx": 0.2353201061487198,
      "pose_rmse_dy": 0.19392049312591553,
      "pose_rmse_mean": 0.3200500011444092,
      "rmse_dtheta": 0.05739006772637367,
      "rmse_dx": 0.02503288723528385,
      "rmse_dy": 0.015202951617538929,
      "rmse_mean": 0.032541971653699875,
      "rotation_flip": 0.013784460723400116,
      "sparse_tokens": 13122.0,
      "step": 666,
      "turn_loss": 0.3251899182796478,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.030988663817134363,
      "grad_norm": 0.45422032475471497,
      "learning_rate": 9.94797195178249e-06,
      "loss": 0.1459,
      "mae_dtheta": 0.010995275340974331,
      "mae_dx": 0.0024107866920530796,
      "mae_dy": 0.0019408519146963954,
      "pose_mae_dtheta": 0.08117244392633438,
      "pose_mae_dx": 0.02740371599793434,
      "pose_mae_dy": 0.03047069162130356,
      "pose_rmse_dtheta": 0.19704265892505646,
      "pose_rmse_dx": 0.08802008628845215,
      "pose_rmse_dy": 0.07478690147399902,
      "pose_rmse_mean": 0.11994987726211548,
      "rmse_dtheta": 0.024188615381717682,
      "rmse_dx": 0.008821364492177963,
      "rmse_dy": 0.0039613088592886925,
      "rmse_mean": 0.012323763221502304,
      "rotation_flip": 0.002097535412758589,
      "sparse_tokens": 32089.0,
      "step": 667,
      "turn_loss": 0.0925854966044426,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.031035123582977144,
      "grad_norm": 0.6946919560432434,
      "learning_rate": 9.947781531051231e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.011481543071568012,
      "mae_dx": 0.0022441993933171034,
      "mae_dy": 0.0015074792318046093,
      "pose_mae_dtheta": 0.08846895396709442,
      "pose_mae_dx": 0.02515910007059574,
      "pose_mae_dy": 0.02369973435997963,
      "pose_rmse_dtheta": 0.2562781572341919,
      "pose_rmse_dx": 0.07247832417488098,
      "pose_rmse_dy": 0.06896479427814484,
      "pose_rmse_mean": 0.13257376849651337,
      "rmse_dtheta": 0.0297248512506485,
      "rmse_dx": 0.007547201123088598,
      "rmse_dy": 0.004259962122887373,
      "rmse_mean": 0.013844004832208157,
      "rotation_flip": 0.0020833334419876337,
      "sparse_tokens": 32121.0,
      "step": 668,
      "turn_loss": 0.07830298691987991,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.03108158334881992,
      "grad_norm": 0.5071788430213928,
      "learning_rate": 9.94759076431895e-06,
      "loss": 0.0792,
      "mae_dtheta": 0.0074823410250246525,
      "mae_dx": 0.0015612301649525762,
      "mae_dy": 0.0007773831021040678,
      "pose_mae_dtheta": 0.04983081668615341,
      "pose_mae_dx": 0.014254754409193993,
      "pose_mae_dy": 0.011537897400557995,
      "pose_rmse_dtheta": 0.16454489529132843,
      "pose_rmse_dx": 0.04141703620553017,
      "pose_rmse_dy": 0.02799483761191368,
      "pose_rmse_mean": 0.07798559218645096,
      "rmse_dtheta": 0.021806983277201653,
      "rmse_dx": 0.005155010614544153,
      "rmse_dy": 0.001784850494004786,
      "rmse_mean": 0.009582281112670898,
      "rotation_flip": 0.002133333357051015,
      "sparse_tokens": 32137.0,
      "step": 669,
      "turn_loss": 0.05673085153102875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0311280431146627,
      "grad_norm": 0.9297208189964294,
      "learning_rate": 9.947399651598993e-06,
      "loss": 0.1991,
      "mae_dtheta": 0.01758384145796299,
      "mae_dx": 0.0033035052474588156,
      "mae_dy": 0.004476917441934347,
      "pose_mae_dtheta": 0.1372194141149521,
      "pose_mae_dx": 0.03928038477897644,
      "pose_mae_dy": 0.05157056823372841,
      "pose_rmse_dtheta": 0.34108078479766846,
      "pose_rmse_dx": 0.11083351820707321,
      "pose_rmse_dy": 0.14313378930091858,
      "pose_rmse_mean": 0.19834935665130615,
      "rmse_dtheta": 0.03600350394845009,
      "rmse_dx": 0.009842264465987682,
      "rmse_dy": 0.011716887354850769,
      "rmse_mean": 0.019187552854418755,
      "rotation_flip": 0.007966616190969944,
      "sparse_tokens": 32089.0,
      "step": 670,
      "turn_loss": 0.16116897761821747,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.03117450288050548,
      "grad_norm": 0.6552073359489441,
      "learning_rate": 9.947208192904722e-06,
      "loss": 0.1426,
      "mae_dtheta": 0.011949654668569565,
      "mae_dx": 0.002200558315962553,
      "mae_dy": 0.002146068261936307,
      "pose_mae_dtheta": 0.08785700798034668,
      "pose_mae_dx": 0.026885105296969414,
      "pose_mae_dy": 0.03547737002372742,
      "pose_rmse_dtheta": 0.2264433652162552,
      "pose_rmse_dx": 0.08288184553384781,
      "pose_rmse_dy": 0.09277921169996262,
      "pose_rmse_mean": 0.13403481245040894,
      "rmse_dtheta": 0.026000333949923515,
      "rmse_dx": 0.008580468595027924,
      "rmse_dy": 0.0045786588452756405,
      "rmse_mean": 0.013053154572844505,
      "rotation_flip": 0.004249291960150003,
      "sparse_tokens": 32041.0,
      "step": 671,
      "turn_loss": 0.08500902354717255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.03122096264634826,
      "grad_norm": 0.5109063982963562,
      "learning_rate": 9.947016388249529e-06,
      "loss": 0.1307,
      "mae_dtheta": 0.013845829293131828,
      "mae_dx": 0.00276525248773396,
      "mae_dy": 0.003129385644569993,
      "pose_mae_dtheta": 0.1069338321685791,
      "pose_mae_dx": 0.03125767782330513,
      "pose_mae_dy": 0.04049244895577431,
      "pose_rmse_dtheta": 0.2811127007007599,
      "pose_rmse_dx": 0.08182279765605927,
      "pose_rmse_dy": 0.10730107873678207,
      "pose_rmse_mean": 0.1567455232143402,
      "rmse_dtheta": 0.03208598122000694,
      "rmse_dx": 0.008402221836149693,
      "rmse_dy": 0.008234593085944653,
      "rmse_mean": 0.016240932047367096,
      "rotation_flip": 0.005111524369567633,
      "sparse_tokens": 32089.0,
      "step": 672,
      "turn_loss": 0.12490949034690857,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.03126742241219104,
      "grad_norm": 1.9030177593231201,
      "learning_rate": 9.946824237646823e-06,
      "loss": 0.3337,
      "mae_dtheta": 0.029919298365712166,
      "mae_dx": 0.01574728637933731,
      "mae_dy": 0.008474784903228283,
      "pose_mae_dtheta": 0.23300573229789734,
      "pose_mae_dx": 0.1393577754497528,
      "pose_mae_dy": 0.11032896488904953,
      "pose_rmse_dtheta": 0.4710685908794403,
      "pose_rmse_dx": 0.29998230934143066,
      "pose_rmse_dy": 0.2863471806049347,
      "pose_rmse_mean": 0.35246604681015015,
      "rmse_dtheta": 0.04825543239712715,
      "rmse_dx": 0.029421644285321236,
      "rmse_dy": 0.01859160326421261,
      "rmse_mean": 0.032089561223983765,
      "rotation_flip": 0.010909090749919415,
      "sparse_tokens": 4428.0,
      "step": 673,
      "turn_loss": 0.29840579628944397,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.031313882178033825,
      "grad_norm": 0.7122209072113037,
      "learning_rate": 9.946631741110043e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.030840136110782623,
      "mae_dx": 0.00801671389490366,
      "mae_dy": 0.004505905322730541,
      "pose_mae_dtheta": 0.22783230245113373,
      "pose_mae_dx": 0.06391317397356033,
      "pose_mae_dy": 0.05908248573541641,
      "pose_rmse_dtheta": 0.41937437653541565,
      "pose_rmse_dx": 0.1542106419801712,
      "pose_rmse_dy": 0.1301116645336151,
      "pose_rmse_mean": 0.2345655858516693,
      "rmse_dtheta": 0.049370549619197845,
      "rmse_dx": 0.01931644417345524,
      "rmse_dy": 0.00853300467133522,
      "rmse_mean": 0.025739997625350952,
      "rotation_flip": 0.015071590431034565,
      "sparse_tokens": 23298.0,
      "step": 674,
      "turn_loss": 0.22517815232276917,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0313603419438766,
      "grad_norm": 0.8892500400543213,
      "learning_rate": 9.94643889865265e-06,
      "loss": 0.1754,
      "mae_dtheta": 0.014997933991253376,
      "mae_dx": 0.004509489051997662,
      "mae_dy": 0.006462938617914915,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8892503976821899,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.4236602783203,
      "model/head/act_norm_mean": 98.16384548611111,
      "model/head/act_norm_min": 49.14287185668945,
      "model/head/act_over_embed": 67.45911364245646,
      "model/head/grad_frac": 0.09575511515140533,
      "model/head/grad_norm": 0.08515027165412903,
      "model/head/grad_zero_frac": 0.0001570495223859325,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6876775568181818,
      "model/head/update_ratio": 0.0014881340321153402,
      "model/head/weight_delta": 2.904129981994629,
      "model/head/weight_delta_rel": 0.05094704031944275,
      "model/head/weight_norm": 57.21949005126953,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4107512831687927,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41066272442157453,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4106035530567169,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28221126890750603,
      "model/modality_embedder.encoders.pose/grad_frac": 0.061399634927511215,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05459965020418167,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5227569994343891,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017808345146477222,
      "model/modality_embedder.encoders.pose/weight_delta": 0.8617076277732849,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.02815467305481434,
      "model/modality_embedder.encoders.pose/weight_norm": 30.65958595275879,
      "model/modality_embedder/grad_frac": 0.061399634927511215,
      "model/modality_embedder/grad_norm": 0.05459965020418167,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5227569994343891,
      "model/modality_embedder/update_ratio": 0.0017808345146477222,
      "model/modality_embedder/weight_delta": 0.8617076277732849,
      "model/modality_embedder/weight_delta_rel": 0.02815467305481434,
      "model/modality_embedder/weight_norm": 30.65958595275879,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.43511199951172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.17609377505211,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.9440279006958,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.239619258076774,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07445665448904037,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06621061265468597,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0024082204326987267,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.41872379183769226,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.015258547849953175,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.49358367919922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 75.55280303955078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.22809944684945,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.106484413146973,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.962567404768178,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07537197321653366,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06702455878257751,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0023140348494052887,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.492467999458313,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.017059477046132088,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.96436882019043,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 77.50711822509766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.208172999839668,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.151199340820312,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.323292488123727,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08027447760105133,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07138410955667496,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0023887453135102987,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.5050620436668396,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.016959037631750107,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.883516311645508,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 78.38725280761719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.234946188071188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.860657691955566,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.71610999802597,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0964002013206482,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08572391420602798,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 9.582795610185713e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0029223416931927204,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.4230571985244751,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.014458087272942066,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.333980560302734,
      "model/normalizer/grad_frac": 0.4050491154193878,
      "model/normalizer/grad_norm": 0.36019009351730347,
      "model/normalizer/grad_zero_frac": 0.00010871993436012417,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00463262340053916,
      "model/normalizer/weight_delta": 0.9484835863113403,
      "model/normalizer/weight_delta_rel": 0.01221591979265213,
      "model/normalizer/weight_norm": 77.75078582763672,
      "pose_mae_dtheta": 0.11258235573768616,
      "pose_mae_dx": 0.05144743248820305,
      "pose_mae_dy": 0.07585141807794571,
      "pose_rmse_dtheta": 0.236151784658432,
      "pose_rmse_dx": 0.11934570968151093,
      "pose_rmse_dy": 0.2179938405752182,
      "pose_rmse_mean": 0.1911637783050537,
      "rmse_dtheta": 0.02764994092285633,
      "rmse_dx": 0.011817936785519123,
      "rmse_dy": 0.016839466989040375,
      "rmse_mean": 0.018769115209579468,
      "rotation_flip": 0.008477569557726383,
      "sparse_tokens": 32089.0,
      "step": 675,
      "turn_loss": 0.16520337760448456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19744.0,
      "epoch": 0.031406801709719386,
      "grad_norm": 0.4314565360546112,
      "learning_rate": 9.946245710288132e-06,
      "loss": 0.1226,
      "mae_dtheta": 0.043595653027296066,
      "mae_dx": 0.018064681440591812,
      "mae_dy": 0.0049963537603616714,
      "pose_mae_dtheta": 0.38735464215278625,
      "pose_mae_dx": 0.13457278907299042,
      "pose_mae_dy": 0.06534312665462494,
      "pose_rmse_dtheta": 0.6159873604774475,
      "pose_rmse_dx": 0.25865957140922546,
      "pose_rmse_dy": 0.1407293826341629,
      "pose_rmse_mean": 0.338458776473999,
      "rmse_dtheta": 0.06151209771633148,
      "rmse_dx": 0.03089948371052742,
      "rmse_dy": 0.008676787838339806,
      "rmse_mean": 0.03369612246751785,
      "rotation_flip": 0.015259410254657269,
      "sparse_tokens": 15551.0,
      "step": 676,
      "turn_loss": 0.3015018701553345,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.03145326147556216,
      "grad_norm": 0.5279867053031921,
      "learning_rate": 9.946052176029994e-06,
      "loss": 0.1278,
      "mae_dtheta": 0.015044196508824825,
      "mae_dx": 0.0021353112533688545,
      "mae_dy": 0.003117799060419202,
      "pose_mae_dtheta": 0.09961948543787003,
      "pose_mae_dx": 0.03215537220239639,
      "pose_mae_dy": 0.04134943708777428,
      "pose_rmse_dtheta": 0.2189570814371109,
      "pose_rmse_dx": 0.0722150206565857,
      "pose_rmse_dy": 0.09064289182424545,
      "pose_rmse_mean": 0.12727166712284088,
      "rmse_dtheta": 0.029339499771595,
      "rmse_dx": 0.005725418217480183,
      "rmse_dy": 0.0063169714994728565,
      "rmse_mean": 0.013793963007628918,
      "rotation_flip": 0.0031723652500659227,
      "sparse_tokens": 32089.0,
      "step": 677,
      "turn_loss": 0.11269684880971909,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.031499721241404946,
      "grad_norm": 0.6106619834899902,
      "learning_rate": 9.945858295891776e-06,
      "loss": 0.1435,
      "mae_dtheta": 0.011842148378491402,
      "mae_dx": 0.001957736210897565,
      "mae_dy": 0.0026671108789741993,
      "pose_mae_dtheta": 0.08224989473819733,
      "pose_mae_dx": 0.025835657492280006,
      "pose_mae_dy": 0.03858310729265213,
      "pose_rmse_dtheta": 0.20036372542381287,
      "pose_rmse_dx": 0.07330406457185745,
      "pose_rmse_dy": 0.11295097321271896,
      "pose_rmse_mean": 0.12887293100357056,
      "rmse_dtheta": 0.024751318618655205,
      "rmse_dx": 0.0062997061759233475,
      "rmse_dy": 0.006914914585649967,
      "rmse_mean": 0.01265531312674284,
      "rotation_flip": 0.0034290612675249577,
      "sparse_tokens": 32073.0,
      "step": 678,
      "turn_loss": 0.10695706307888031,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.03154618100724772,
      "grad_norm": 0.6729902029037476,
      "learning_rate": 9.945664069887028e-06,
      "loss": 0.1136,
      "mae_dtheta": 0.009932556189596653,
      "mae_dx": 0.0027465398889034986,
      "mae_dy": 0.001405799761414528,
      "pose_mae_dtheta": 0.07143019139766693,
      "pose_mae_dx": 0.028259459882974625,
      "pose_mae_dy": 0.02490840293467045,
      "pose_rmse_dtheta": 0.16648586094379425,
      "pose_rmse_dx": 0.068818598985672,
      "pose_rmse_dy": 0.06720837950706482,
      "pose_rmse_mean": 0.10083761066198349,
      "rmse_dtheta": 0.02230689860880375,
      "rmse_dx": 0.00780256325379014,
      "rmse_dy": 0.003511606017127633,
      "rmse_mean": 0.01120702363550663,
      "rotation_flip": 0.003294892841950059,
      "sparse_tokens": 32201.0,
      "step": 679,
      "turn_loss": 0.07732223719358444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.031592640773090507,
      "grad_norm": 0.6366832256317139,
      "learning_rate": 9.94546949802934e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.032673630863428116,
      "mae_dx": 0.015051824040710926,
      "mae_dy": 0.004691843409091234,
      "pose_mae_dtheta": 0.24583905935287476,
      "pose_mae_dx": 0.12280748039484024,
      "pose_mae_dy": 0.06107277050614357,
      "pose_rmse_dtheta": 0.4404827058315277,
      "pose_rmse_dx": 0.26939308643341064,
      "pose_rmse_dy": 0.11854279041290283,
      "pose_rmse_mean": 0.2761395573616028,
      "rmse_dtheta": 0.04932956025004387,
      "rmse_dx": 0.02892405539751053,
      "rmse_dy": 0.00832449272274971,
      "rmse_mean": 0.028859367594122887,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 5704.0,
      "step": 680,
      "turn_loss": 0.309047669172287,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.03163910053893328,
      "grad_norm": 0.5315651297569275,
      "learning_rate": 9.945274580332316e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.016046248376369476,
      "mae_dx": 0.004025779664516449,
      "mae_dy": 0.004561412148177624,
      "pose_mae_dtheta": 0.11763635277748108,
      "pose_mae_dx": 0.05226944759488106,
      "pose_mae_dy": 0.04619225114583969,
      "pose_rmse_dtheta": 0.264713853597641,
      "pose_rmse_dx": 0.12752631306648254,
      "pose_rmse_dy": 0.12152664363384247,
      "pose_rmse_mean": 0.17125561833381653,
      "rmse_dtheta": 0.03164951875805855,
      "rmse_dx": 0.010413175448775291,
      "rmse_dy": 0.010936587117612362,
      "rmse_mean": 0.017666427418589592,
      "rotation_flip": 0.003310040570795536,
      "sparse_tokens": 32153.0,
      "step": 681,
      "turn_loss": 0.1363275647163391,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.03168556030477607,
      "grad_norm": 0.5464723706245422,
      "learning_rate": 9.945079316809585e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.02255016565322876,
      "mae_dx": 0.008486079052090645,
      "mae_dy": 0.00557464174926281,
      "pose_mae_dtheta": 0.1752214878797531,
      "pose_mae_dx": 0.09114408493041992,
      "pose_mae_dy": 0.07913679629564285,
      "pose_rmse_dtheta": 0.3222266435623169,
      "pose_rmse_dx": 0.24434153735637665,
      "pose_rmse_dy": 0.20666158199310303,
      "pose_rmse_mean": 0.2577432692050934,
      "rmse_dtheta": 0.03568386659026146,
      "rmse_dx": 0.02183041162788868,
      "rmse_dy": 0.01080952025949955,
      "rmse_mean": 0.022774599492549896,
      "rotation_flip": 0.00948509480804205,
      "sparse_tokens": 15065.0,
      "step": 682,
      "turn_loss": 0.24949410557746887,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 31046.0,
      "epoch": 0.031732020070618844,
      "grad_norm": 0.6230869889259338,
      "learning_rate": 9.944883707474803e-06,
      "loss": 0.1656,
      "mae_dtheta": 0.030180733650922775,
      "mae_dx": 0.008353793062269688,
      "mae_dy": 0.005713512189686298,
      "pose_mae_dtheta": 0.25644850730895996,
      "pose_mae_dx": 0.07280630618333817,
      "pose_mae_dy": 0.0998726412653923,
      "pose_rmse_dtheta": 0.44266000390052795,
      "pose_rmse_dx": 0.18001727759838104,
      "pose_rmse_dy": 0.19988912343978882,
      "pose_rmse_mean": 0.2741888165473938,
      "rmse_dtheta": 0.047015465795993805,
      "rmse_dx": 0.01987711898982525,
      "rmse_dy": 0.010068965144455433,
      "rmse_mean": 0.02565385214984417,
      "rotation_flip": 0.006456819828599691,
      "sparse_tokens": 24528.0,
      "step": 683,
      "turn_loss": 0.22327177226543427,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.03177847983646163,
      "grad_norm": 0.6940455436706543,
      "learning_rate": 9.944687752341651e-06,
      "loss": 0.1496,
      "mae_dtheta": 0.03970961272716522,
      "mae_dx": 0.019287966191768646,
      "mae_dy": 0.009986557066440582,
      "pose_mae_dtheta": 0.3177202343940735,
      "pose_mae_dx": 0.15143346786499023,
      "pose_mae_dy": 0.11612053960561752,
      "pose_rmse_dtheta": 0.4649343192577362,
      "pose_rmse_dx": 0.2837200462818146,
      "pose_rmse_dy": 0.21881137788295746,
      "pose_rmse_mean": 0.32248860597610474,
      "rmse_dtheta": 0.05335632711648941,
      "rmse_dx": 0.03214595466852188,
      "rmse_dy": 0.01851435750722885,
      "rmse_mean": 0.03467221558094025,
      "rotation_flip": 0.02380952425301075,
      "sparse_tokens": 7603.0,
      "step": 684,
      "turn_loss": 0.3904355466365814,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.031824939602304404,
      "grad_norm": 0.7304459810256958,
      "learning_rate": 9.944491451423829e-06,
      "loss": 0.1527,
      "mae_dtheta": 0.02866283990442753,
      "mae_dx": 0.011070746928453445,
      "mae_dy": 0.005821745842695236,
      "pose_mae_dtheta": 0.21632397174835205,
      "pose_mae_dx": 0.08876831084489822,
      "pose_mae_dy": 0.07528724521398544,
      "pose_rmse_dtheta": 0.3960046172142029,
      "pose_rmse_dx": 0.19969020783901215,
      "pose_rmse_dy": 0.1621776968240738,
      "pose_rmse_mean": 0.25262418389320374,
      "rmse_dtheta": 0.0449705496430397,
      "rmse_dx": 0.02378133311867714,
      "rmse_dy": 0.010751070454716682,
      "rmse_mean": 0.026500985026359558,
      "rotation_flip": 0.01312335953116417,
      "sparse_tokens": 19261.0,
      "step": 685,
      "turn_loss": 0.2518332600593567,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.03187139936814719,
      "grad_norm": 0.5082427859306335,
      "learning_rate": 9.944294804735067e-06,
      "loss": 0.1579,
      "mae_dtheta": 0.039152488112449646,
      "mae_dx": 0.015203232876956463,
      "mae_dy": 0.007374377455562353,
      "pose_mae_dtheta": 0.32623645663261414,
      "pose_mae_dx": 0.11773474514484406,
      "pose_mae_dy": 0.09990491718053818,
      "pose_rmse_dtheta": 0.5433956384658813,
      "pose_rmse_dx": 0.23585741221904755,
      "pose_rmse_dy": 0.1988300234079361,
      "pose_rmse_mean": 0.32602769136428833,
      "rmse_dtheta": 0.05659027025103569,
      "rmse_dx": 0.028993822634220123,
      "rmse_dy": 0.011262267827987671,
      "rmse_mean": 0.03228212147951126,
      "rotation_flip": 0.009027081541717052,
      "sparse_tokens": 16234.0,
      "step": 686,
      "turn_loss": 0.3158574402332306,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 12999.0,
      "epoch": 0.031917859133989965,
      "grad_norm": 0.4310937523841858,
      "learning_rate": 9.944097812289115e-06,
      "loss": 0.1054,
      "mae_dtheta": 0.031155066564679146,
      "mae_dx": 0.01395419705659151,
      "mae_dy": 0.0063296835869550705,
      "pose_mae_dtheta": 0.21762937307357788,
      "pose_mae_dx": 0.10820681601762772,
      "pose_mae_dy": 0.07279375195503235,
      "pose_rmse_dtheta": 0.42064908146858215,
      "pose_rmse_dx": 0.22569134831428528,
      "pose_rmse_dy": 0.15729013085365295,
      "pose_rmse_mean": 0.26787686347961426,
      "rmse_dtheta": 0.04988633468747139,
      "rmse_dx": 0.026622066274285316,
      "rmse_dy": 0.012407527305185795,
      "rmse_mean": 0.02963864430785179,
      "rotation_flip": 0.012544803321361542,
      "sparse_tokens": 10078.0,
      "step": 687,
      "turn_loss": 0.29143428802490234,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.03196431889983274,
      "grad_norm": 0.5643424391746521,
      "learning_rate": 9.943900474099748e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.01410809438675642,
      "mae_dx": 0.00426543178036809,
      "mae_dy": 0.004189901985228062,
      "pose_mae_dtheta": 0.1027306616306305,
      "pose_mae_dx": 0.05553092807531357,
      "pose_mae_dy": 0.04922071471810341,
      "pose_rmse_dtheta": 0.26683712005615234,
      "pose_rmse_dx": 0.16282379627227783,
      "pose_rmse_dy": 0.15615807473659515,
      "pose_rmse_mean": 0.1952730119228363,
      "rmse_dtheta": 0.03123794123530388,
      "rmse_dx": 0.012327320873737335,
      "rmse_dy": 0.011849360540509224,
      "rmse_mean": 0.01847154274582863,
      "rotation_flip": 0.004127967171370983,
      "sparse_tokens": 32041.0,
      "step": 688,
      "turn_loss": 0.1573433130979538,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.032010778665675525,
      "grad_norm": 0.7241863012313843,
      "learning_rate": 9.94370279018077e-06,
      "loss": 0.1426,
      "mae_dtheta": 0.015121537260711193,
      "mae_dx": 0.002214417327195406,
      "mae_dy": 0.0031192905735224485,
      "pose_mae_dtheta": 0.09932299703359604,
      "pose_mae_dx": 0.03299713879823685,
      "pose_mae_dy": 0.041820697486400604,
      "pose_rmse_dtheta": 0.19930684566497803,
      "pose_rmse_dx": 0.08096753805875778,
      "pose_rmse_dy": 0.10194110125303268,
      "pose_rmse_mean": 0.12740516662597656,
      "rmse_dtheta": 0.027041975408792496,
      "rmse_dx": 0.007070362567901611,
      "rmse_dy": 0.0058982339687645435,
      "rmse_mean": 0.01333685778081417,
      "rotation_flip": 0.0017717930022627115,
      "sparse_tokens": 32073.0,
      "step": 689,
      "turn_loss": 0.11829618364572525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.0320572384315183,
      "grad_norm": 0.45884624123573303,
      "learning_rate": 9.943504760546e-06,
      "loss": 0.1447,
      "mae_dtheta": 0.010736985132098198,
      "mae_dx": 0.0034724543802440166,
      "mae_dy": 0.002402740763500333,
      "pose_mae_dtheta": 0.07936149835586548,
      "pose_mae_dx": 0.03260350227355957,
      "pose_mae_dy": 0.025710534304380417,
      "pose_rmse_dtheta": 0.20667214691638947,
      "pose_rmse_dx": 0.0805840790271759,
      "pose_rmse_dy": 0.07301562279462814,
      "pose_rmse_mean": 0.12009062618017197,
      "rmse_dtheta": 0.02579505369067192,
      "rmse_dx": 0.009446026757359505,
      "rmse_dy": 0.006526328157633543,
      "rmse_mean": 0.01392247062176466,
      "rotation_flip": 0.003264925442636013,
      "sparse_tokens": 32185.0,
      "step": 690,
      "turn_loss": 0.11739399284124374,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.032103698197361086,
      "grad_norm": 0.6067662239074707,
      "learning_rate": 9.94330638520929e-06,
      "loss": 0.1448,
      "mae_dtheta": 0.010703652165830135,
      "mae_dx": 0.0016590321902185678,
      "mae_dy": 0.002482941374182701,
      "pose_mae_dtheta": 0.07211410254240036,
      "pose_mae_dx": 0.024493427947163582,
      "pose_mae_dy": 0.029782721772789955,
      "pose_rmse_dtheta": 0.18291132152080536,
      "pose_rmse_dx": 0.06393398344516754,
      "pose_rmse_dy": 0.0771554484963417,
      "pose_rmse_mean": 0.108000248670578,
      "rmse_dtheta": 0.02265745960175991,
      "rmse_dx": 0.005483809392899275,
      "rmse_dy": 0.005802566651254892,
      "rmse_mean": 0.01131461188197136,
      "rotation_flip": 0.005343197844922543,
      "sparse_tokens": 32073.0,
      "step": 691,
      "turn_loss": 0.08053196966648102,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.03215015796320386,
      "grad_norm": 0.46466559171676636,
      "learning_rate": 9.94310766418451e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.009581432677805424,
      "mae_dx": 0.0021813593339174986,
      "mae_dy": 0.0012340889079496264,
      "pose_mae_dtheta": 0.0736471638083458,
      "pose_mae_dx": 0.0198582224547863,
      "pose_mae_dy": 0.01835692673921585,
      "pose_rmse_dtheta": 0.21544469892978668,
      "pose_rmse_dx": 0.05490409955382347,
      "pose_rmse_dy": 0.05389459803700447,
      "pose_rmse_mean": 0.10808113217353821,
      "rmse_dtheta": 0.024939270690083504,
      "rmse_dx": 0.007132448256015778,
      "rmse_dy": 0.0033242618665099144,
      "rmse_mean": 0.011798660270869732,
      "rotation_flip": 0.002721829107031226,
      "sparse_tokens": 32121.0,
      "step": 692,
      "turn_loss": 0.07011272013187408,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.032196617729046646,
      "grad_norm": 1.0297174453735352,
      "learning_rate": 9.942908597485558e-06,
      "loss": 0.2918,
      "mae_dtheta": 0.04371742159128189,
      "mae_dx": 0.015530306845903397,
      "mae_dy": 0.005858939606696367,
      "pose_mae_dtheta": 0.39806267619132996,
      "pose_mae_dx": 0.08401662111282349,
      "pose_mae_dy": 0.08216681331396103,
      "pose_rmse_dtheta": 0.6891363859176636,
      "pose_rmse_dx": 0.1995312124490738,
      "pose_rmse_dy": 0.21211665868759155,
      "pose_rmse_mean": 0.3669281005859375,
      "rmse_dtheta": 0.06593646109104156,
      "rmse_dx": 0.02874426357448101,
      "rmse_dy": 0.011441607028245926,
      "rmse_mean": 0.03537411242723465,
      "rotation_flip": 0.008510638028383255,
      "sparse_tokens": 4075.0,
      "step": 693,
      "turn_loss": 0.23772737383842468,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 18450.0,
      "epoch": 0.03224307749488942,
      "grad_norm": 0.5893475413322449,
      "learning_rate": 9.942709185126357e-06,
      "loss": 0.1595,
      "mae_dtheta": 0.03067340888082981,
      "mae_dx": 0.010454671457409859,
      "mae_dy": 0.005797492805868387,
      "pose_mae_dtheta": 0.20518158376216888,
      "pose_mae_dx": 0.08906260877847672,
      "pose_mae_dy": 0.07664649933576584,
      "pose_rmse_dtheta": 0.39834555983543396,
      "pose_rmse_dx": 0.18431736528873444,
      "pose_rmse_dy": 0.1730012446641922,
      "pose_rmse_mean": 0.25188806653022766,
      "rmse_dtheta": 0.047544725239276886,
      "rmse_dx": 0.022385627031326294,
      "rmse_dy": 0.01088976301252842,
      "rmse_mean": 0.026940038427710533,
      "rotation_flip": 0.014563106931746006,
      "sparse_tokens": 13389.0,
      "step": 694,
      "turn_loss": 0.28589341044425964,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.03228953726073221,
      "grad_norm": 0.4987994432449341,
      "learning_rate": 9.942509427120848e-06,
      "loss": 0.0946,
      "mae_dtheta": 0.009599735960364342,
      "mae_dx": 0.0022028505336493254,
      "mae_dy": 0.002571024000644684,
      "pose_mae_dtheta": 0.0654696375131607,
      "pose_mae_dx": 0.029777012765407562,
      "pose_mae_dy": 0.030560439452528954,
      "pose_rmse_dtheta": 0.13501201570034027,
      "pose_rmse_dx": 0.07286082953214645,
      "pose_rmse_dy": 0.08600141108036041,
      "pose_rmse_mean": 0.09795808792114258,
      "rmse_dtheta": 0.019693562760949135,
      "rmse_dx": 0.006274051032960415,
      "rmse_dy": 0.0058698286302387714,
      "rmse_mean": 0.010612480342388153,
      "rotation_flip": 0.004092262126505375,
      "sparse_tokens": 32137.0,
      "step": 695,
      "turn_loss": 0.09061324596405029,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.032335997026574984,
      "grad_norm": 0.5460679531097412,
      "learning_rate": 9.942309323483003e-06,
      "loss": 0.1314,
      "mae_dtheta": 0.03608202189207077,
      "mae_dx": 0.013095531612634659,
      "mae_dy": 0.004646265413612127,
      "pose_mae_dtheta": 0.29737192392349243,
      "pose_mae_dx": 0.11948191374540329,
      "pose_mae_dy": 0.059960220009088516,
      "pose_rmse_dtheta": 0.5192962288856506,
      "pose_rmse_dx": 0.261080265045166,
      "pose_rmse_dy": 0.13465715944766998,
      "pose_rmse_mean": 0.30501121282577515,
      "rmse_dtheta": 0.053765907883644104,
      "rmse_dx": 0.02590511552989483,
      "rmse_dy": 0.008137230761349201,
      "rmse_mean": 0.029269419610500336,
      "rotation_flip": 0.014505892992019653,
      "sparse_tokens": 18730.0,
      "step": 696,
      "turn_loss": 0.23414090275764465,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.03238245679241777,
      "grad_norm": 0.8011932969093323,
      "learning_rate": 9.942108874226812e-06,
      "loss": 0.1372,
      "mae_dtheta": 0.007969597354531288,
      "mae_dx": 0.0016340833390131593,
      "mae_dy": 0.001417863299138844,
      "pose_mae_dtheta": 0.05230451747775078,
      "pose_mae_dx": 0.015513433143496513,
      "pose_mae_dy": 0.021051615476608276,
      "pose_rmse_dtheta": 0.13388371467590332,
      "pose_rmse_dx": 0.04170374572277069,
      "pose_rmse_dy": 0.05360330268740654,
      "pose_rmse_mean": 0.07639692723751068,
      "rmse_dtheta": 0.018414752557873726,
      "rmse_dx": 0.005255948752164841,
      "rmse_dy": 0.0032770000398159027,
      "rmse_mean": 0.008982567116618156,
      "rotation_flip": 0.007270693313330412,
      "sparse_tokens": 32073.0,
      "step": 697,
      "turn_loss": 0.06544666737318039,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.032428916558260544,
      "grad_norm": 0.4462737441062927,
      "learning_rate": 9.941908079366298e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.011581841856241226,
      "mae_dx": 0.0021530925296247005,
      "mae_dy": 0.0020536885131150484,
      "pose_mae_dtheta": 0.0769851878285408,
      "pose_mae_dx": 0.027350643649697304,
      "pose_mae_dy": 0.03228672593832016,
      "pose_rmse_dtheta": 0.18630924820899963,
      "pose_rmse_dx": 0.06687280535697937,
      "pose_rmse_dy": 0.08212237805128098,
      "pose_rmse_mean": 0.11176814883947372,
      "rmse_dtheta": 0.026203090324997902,
      "rmse_dx": 0.00645946990698576,
      "rmse_dy": 0.004014985170215368,
      "rmse_mean": 0.012225847691297531,
      "rotation_flip": 0.0034217280335724354,
      "sparse_tokens": 32089.0,
      "step": 698,
      "turn_loss": 0.10599939525127411,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.03247537632410333,
      "grad_norm": 0.4369029402732849,
      "learning_rate": 9.941706938915498e-06,
      "loss": 0.1006,
      "mae_dtheta": 0.009724554605782032,
      "mae_dx": 0.0017333583673462272,
      "mae_dy": 0.0019760034047067165,
      "pose_mae_dtheta": 0.06460749357938766,
      "pose_mae_dx": 0.02191684953868389,
      "pose_mae_dy": 0.027455586940050125,
      "pose_rmse_dtheta": 0.18292450904846191,
      "pose_rmse_dx": 0.0608862079679966,
      "pose_rmse_dy": 0.09592220187187195,
      "pose_rmse_mean": 0.11324431002140045,
      "rmse_dtheta": 0.02340836264193058,
      "rmse_dx": 0.005610354244709015,
      "rmse_dy": 0.0047502582892775536,
      "rmse_mean": 0.01125632505863905,
      "rotation_flip": 0.0034448818769305944,
      "sparse_tokens": 32073.0,
      "step": 699,
      "turn_loss": 0.07856947183609009,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.032521836089946105,
      "grad_norm": 0.49951332807540894,
      "learning_rate": 9.941505452888478e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.036432623863220215,
      "mae_dx": 0.005558003671467304,
      "mae_dy": 0.004130191635340452,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.49951326847076416,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 130.74844360351562,
      "model/head/act_norm_mean": 99.18793194110577,
      "model/head/act_norm_min": 63.26881790161133,
      "model/head/act_over_embed": 68.16287544197723,
      "model/head/grad_frac": 0.11109010130167007,
      "model/head/grad_norm": 0.05549097806215286,
      "model/head/grad_zero_frac": 0.0001519731740700081,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6727013221153846,
      "model/head/update_ratio": 0.000969654240179807,
      "model/head/weight_delta": 2.951345682144165,
      "model/head/weight_delta_rel": 0.05177534371614456,
      "model/head/weight_norm": 57.22759246826172,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41086119413375854,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41081483023507254,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4107784926891327,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2823157974465789,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0912880077958107,
      "model/modality_embedder.encoders.pose/grad_norm": 0.045599572360515594,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5408761160714286,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001487193745560944,
      "model/modality_embedder.encoders.pose/weight_delta": 0.8763905167579651,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.028634410351514816,
      "model/modality_embedder.encoders.pose/weight_norm": 30.661487579345703,
      "model/modality_embedder/grad_frac": 0.0912880077958107,
      "model/modality_embedder/grad_norm": 0.045599572360515594,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5408761160714286,
      "model/modality_embedder/update_ratio": 0.001487193745560944,
      "model/modality_embedder/weight_delta": 0.8763905167579651,
      "model/modality_embedder/weight_delta_rel": 0.028634410351514816,
      "model/modality_embedder/weight_norm": 30.661487579345703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 65.85871887207031,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.286057692307693,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.489249229431152,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.315187491513223,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08692605048418045,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04342071712017059,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015792401973158121,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.42833656072616577,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.015608842484652996,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.494688034057617,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 67.71717834472656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.24239735958486,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.819786071777344,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.972393064259121,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08424126356840134,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0420796275138855,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014526107115671039,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.5057879090309143,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.017520887777209282,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.96827507019043,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 69.52347564697266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.00203897664835,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.318521499633789,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.18163525752952,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0845813974738121,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04224953055381775,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014136135578155518,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.519584596157074,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.01744667813181877,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.887609481811523,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 70.6844482421875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.975999694749696,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.353901863098145,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.538159543520177,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08738009631633759,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04364751651883125,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014877616195008159,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.4362533986568451,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.014909070916473866,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.337709426879883,
      "model/normalizer/grad_frac": 0.3158966302871704,
      "model/normalizer/grad_norm": 0.15779456496238708,
      "model/normalizer/grad_zero_frac": 0.00016426164074800909,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020293882116675377,
      "model/normalizer/weight_delta": 0.9743258357048035,
      "model/normalizer/weight_delta_rel": 0.012548753060400486,
      "model/normalizer/weight_norm": 77.75474548339844,
      "pose_mae_dtheta": 0.24935440719127655,
      "pose_mae_dx": 0.03269873932003975,
      "pose_mae_dy": 0.02520010992884636,
      "pose_rmse_dtheta": 0.4399222731590271,
      "pose_rmse_dx": 0.0654764175415039,
      "pose_rmse_dy": 0.055130522698163986,
      "pose_rmse_mean": 0.18684308230876923,
      "rmse_dtheta": 0.055170148611068726,
      "rmse_dx": 0.012393943965435028,
      "rmse_dy": 0.009018518961966038,
      "rmse_mean": 0.025527536869049072,
      "rotation_flip": 0.0,
      "sparse_tokens": 3363.0,
      "step": 700,
      "turn_loss": 0.2688022553920746,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.03256829585578889,
      "grad_norm": 0.3439621925354004,
      "learning_rate": 9.941303621299332e-06,
      "loss": 0.1112,
      "mae_dtheta": 0.008057096973061562,
      "mae_dx": 0.0015534323174506426,
      "mae_dy": 0.0012256705667823553,
      "pose_mae_dtheta": 0.05308984965085983,
      "pose_mae_dx": 0.01672595925629139,
      "pose_mae_dy": 0.01881583407521248,
      "pose_rmse_dtheta": 0.12816490232944489,
      "pose_rmse_dx": 0.042778048664331436,
      "pose_rmse_dy": 0.04532357305288315,
      "pose_rmse_mean": 0.07208883762359619,
      "rmse_dtheta": 0.018949631601572037,
      "rmse_dx": 0.005027232691645622,
      "rmse_dy": 0.002464492805302143,
      "rmse_mean": 0.008813786320388317,
      "rotation_flip": 0.0029965753201395273,
      "sparse_tokens": 32137.0,
      "step": 701,
      "turn_loss": 0.06445954740047455,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.032614755621631665,
      "grad_norm": 0.7418858408927917,
      "learning_rate": 9.94110144416217e-06,
      "loss": 0.2153,
      "mae_dtheta": 0.013870146125555038,
      "mae_dx": 0.0034694697242230177,
      "mae_dy": 0.0034516039304435253,
      "pose_mae_dtheta": 0.10531066358089447,
      "pose_mae_dx": 0.038362178951501846,
      "pose_mae_dy": 0.04307308420538902,
      "pose_rmse_dtheta": 0.23936592042446136,
      "pose_rmse_dx": 0.09198393672704697,
      "pose_rmse_dy": 0.10895311087369919,
      "pose_rmse_mean": 0.14676766097545624,
      "rmse_dtheta": 0.028190437704324722,
      "rmse_dx": 0.010463254526257515,
      "rmse_dy": 0.007953859865665436,
      "rmse_mean": 0.015535851940512657,
      "rotation_flip": 0.006178287789225578,
      "sparse_tokens": 32089.0,
      "step": 702,
      "turn_loss": 0.13306482136249542,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.03266121538747445,
      "grad_norm": 0.489450067281723,
      "learning_rate": 9.940898921491132e-06,
      "loss": 0.1036,
      "mae_dtheta": 0.02605769969522953,
      "mae_dx": 0.00726242596283555,
      "mae_dy": 0.005660578142851591,
      "pose_mae_dtheta": 0.1756698042154312,
      "pose_mae_dx": 0.07036851346492767,
      "pose_mae_dy": 0.06553995609283447,
      "pose_rmse_dtheta": 0.30485284328460693,
      "pose_rmse_dx": 0.16001959145069122,
      "pose_rmse_dy": 0.12994477152824402,
      "pose_rmse_mean": 0.19827239215373993,
      "rmse_dtheta": 0.040659695863723755,
      "rmse_dx": 0.01689528487622738,
      "rmse_dy": 0.009218382649123669,
      "rmse_mean": 0.022257788106799126,
      "rotation_flip": 0.02631578966975212,
      "sparse_tokens": 10904.0,
      "step": 703,
      "turn_loss": 0.193874329328537,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.032707675153317226,
      "grad_norm": 0.4142412543296814,
      "learning_rate": 9.94069605330038e-06,
      "loss": 0.1167,
      "mae_dtheta": 0.010284267365932465,
      "mae_dx": 0.0021755725611001253,
      "mae_dy": 0.003346433397382498,
      "pose_mae_dtheta": 0.07144550234079361,
      "pose_mae_dx": 0.028950417414307594,
      "pose_mae_dy": 0.035654690116643906,
      "pose_rmse_dtheta": 0.14432047307491302,
      "pose_rmse_dx": 0.06881169974803925,
      "pose_rmse_dy": 0.07731345295906067,
      "pose_rmse_mean": 0.09681521356105804,
      "rmse_dtheta": 0.020386720076203346,
      "rmse_dx": 0.005943588446825743,
      "rmse_dy": 0.00683685252442956,
      "rmse_mean": 0.0110557209700346,
      "rotation_flip": 0.006978366989642382,
      "sparse_tokens": 32137.0,
      "step": 704,
      "turn_loss": 0.0922638475894928,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.03275413491916001,
      "grad_norm": 0.6405735015869141,
      "learning_rate": 9.940492839604103e-06,
      "loss": 0.166,
      "mae_dtheta": 0.03549538552761078,
      "mae_dx": 0.014355666935443878,
      "mae_dy": 0.0034448725637048483,
      "pose_mae_dtheta": 0.2715455889701843,
      "pose_mae_dx": 0.1258995234966278,
      "pose_mae_dy": 0.059388305991888046,
      "pose_rmse_dtheta": 0.5015133619308472,
      "pose_rmse_dx": 0.3202361762523651,
      "pose_rmse_dy": 0.12200821191072464,
      "pose_rmse_mean": 0.31458592414855957,
      "rmse_dtheta": 0.052551474422216415,
      "rmse_dx": 0.030170736834406853,
      "rmse_dy": 0.0058656418696045876,
      "rmse_mean": 0.029529284685850143,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 5733.0,
      "step": 705,
      "turn_loss": 0.19306129217147827,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.032800594685002786,
      "grad_norm": 0.5190494656562805,
      "learning_rate": 9.940289280416509e-06,
      "loss": 0.1554,
      "mae_dtheta": 0.013071366585791111,
      "mae_dx": 0.0019563056994229555,
      "mae_dy": 0.0031703237909823656,
      "pose_mae_dtheta": 0.08144821226596832,
      "pose_mae_dx": 0.02928055450320244,
      "pose_mae_dy": 0.03625645488500595,
      "pose_rmse_dtheta": 0.1696714460849762,
      "pose_rmse_dx": 0.07068686187267303,
      "pose_rmse_dy": 0.08130040019750595,
      "pose_rmse_mean": 0.10721956938505173,
      "rmse_dtheta": 0.0240878164768219,
      "rmse_dx": 0.005857993848621845,
      "rmse_dy": 0.006526828743517399,
      "rmse_mean": 0.012157546356320381,
      "rotation_flip": 0.01256106048822403,
      "sparse_tokens": 32089.0,
      "step": 706,
      "turn_loss": 0.10069718211889267,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.03284705445084557,
      "grad_norm": 0.4900543987751007,
      "learning_rate": 9.940085375751834e-06,
      "loss": 0.1182,
      "mae_dtheta": 0.009346261620521545,
      "mae_dx": 0.0018587373197078705,
      "mae_dy": 0.002162307035177946,
      "pose_mae_dtheta": 0.06742528825998306,
      "pose_mae_dx": 0.024054409936070442,
      "pose_mae_dy": 0.028079256415367126,
      "pose_rmse_dtheta": 0.16128253936767578,
      "pose_rmse_dx": 0.060342706739902496,
      "pose_rmse_dy": 0.07909799367189407,
      "pose_rmse_mean": 0.10024107992649078,
      "rmse_dtheta": 0.02006254345178604,
      "rmse_dx": 0.005370328668504953,
      "rmse_dy": 0.005136973224580288,
      "rmse_mean": 0.010189948603510857,
      "rotation_flip": 0.006762849632650614,
      "sparse_tokens": 32105.0,
      "step": 707,
      "turn_loss": 0.07627858966588974,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.032893514216688347,
      "grad_norm": 0.6935869455337524,
      "learning_rate": 9.939881125624336e-06,
      "loss": 0.1629,
      "mae_dtheta": 0.04189269617199898,
      "mae_dx": 0.016855331137776375,
      "mae_dy": 0.004661849699914455,
      "pose_mae_dtheta": 0.34896042943000793,
      "pose_mae_dx": 0.13747438788414001,
      "pose_mae_dy": 0.07957036793231964,
      "pose_rmse_dtheta": 0.6043139100074768,
      "pose_rmse_dx": 0.27140429615974426,
      "pose_rmse_dy": 0.1934565156698227,
      "pose_rmse_mean": 0.3563916087150574,
      "rmse_dtheta": 0.061179857701063156,
      "rmse_dx": 0.03025142475962639,
      "rmse_dy": 0.008633572608232498,
      "rmse_mean": 0.033354952931404114,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 12820.0,
      "step": 708,
      "turn_loss": 0.23918266594409943,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.03293997398253113,
      "grad_norm": 0.47136390209198,
      "learning_rate": 9.9396765300483e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.00648528290912509,
      "mae_dx": 0.0020918555092066526,
      "mae_dy": 0.0014458266086876392,
      "pose_mae_dtheta": 0.05159847438335419,
      "pose_mae_dx": 0.019591931253671646,
      "pose_mae_dy": 0.018416061997413635,
      "pose_rmse_dtheta": 0.17403511703014374,
      "pose_rmse_dx": 0.06614439934492111,
      "pose_rmse_dy": 0.05666252225637436,
      "pose_rmse_mean": 0.09894734621047974,
      "rmse_dtheta": 0.01963099092245102,
      "rmse_dx": 0.0070055751129984856,
      "rmse_dy": 0.006000241730362177,
      "rmse_mean": 0.01087893731892109,
      "rotation_flip": 0.0033624747302383184,
      "sparse_tokens": 32073.0,
      "step": 709,
      "turn_loss": 0.0649329274892807,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16835.0,
      "epoch": 0.03298643374837391,
      "grad_norm": 0.4123551845550537,
      "learning_rate": 9.939471589038034e-06,
      "loss": 0.0936,
      "mae_dtheta": 0.019454387947916985,
      "mae_dx": 0.010282142087817192,
      "mae_dy": 0.0028045405633747578,
      "pose_mae_dtheta": 0.17321957647800446,
      "pose_mae_dx": 0.10419116169214249,
      "pose_mae_dy": 0.047885097563266754,
      "pose_rmse_dtheta": 0.3286246061325073,
      "pose_rmse_dx": 0.262688547372818,
      "pose_rmse_dy": 0.1168084666132927,
      "pose_rmse_mean": 0.23604053258895874,
      "rmse_dtheta": 0.034991487860679626,
      "rmse_dx": 0.024754613637924194,
      "rmse_dy": 0.006194558460265398,
      "rmse_mean": 0.021980222314596176,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 12901.0,
      "step": 710,
      "turn_loss": 0.1842249035835266,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.03303289351421669,
      "grad_norm": 0.5431678295135498,
      "learning_rate": 9.939266302607869e-06,
      "loss": 0.1134,
      "mae_dtheta": 0.013481437228620052,
      "mae_dx": 0.0016507150139659643,
      "mae_dy": 0.0029257109854370356,
      "pose_mae_dtheta": 0.0843089371919632,
      "pose_mae_dx": 0.024994321167469025,
      "pose_mae_dy": 0.041989780962467194,
      "pose_rmse_dtheta": 0.16802406311035156,
      "pose_rmse_dx": 0.06010804697871208,
      "pose_rmse_dy": 0.09260862320661545,
      "pose_rmse_mean": 0.10691358149051666,
      "rmse_dtheta": 0.024439865723252296,
      "rmse_dx": 0.005441368091851473,
      "rmse_dy": 0.005581336561590433,
      "rmse_mean": 0.011820856481790543,
      "rotation_flip": 0.007222824264317751,
      "sparse_tokens": 32041.0,
      "step": 711,
      "turn_loss": 0.10452648997306824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.03307935328005947,
      "grad_norm": 0.7157238125801086,
      "learning_rate": 9.939060670772159e-06,
      "loss": 0.1191,
      "mae_dtheta": 0.011192168109118938,
      "mae_dx": 0.0020900480449199677,
      "mae_dy": 0.0019388147629797459,
      "pose_mae_dtheta": 0.08120881021022797,
      "pose_mae_dx": 0.026490069925785065,
      "pose_mae_dy": 0.025844987481832504,
      "pose_rmse_dtheta": 0.20800912380218506,
      "pose_rmse_dx": 0.05786105617880821,
      "pose_rmse_dy": 0.06264907866716385,
      "pose_rmse_mean": 0.10950642079114914,
      "rmse_dtheta": 0.024800822138786316,
      "rmse_dx": 0.006068708375096321,
      "rmse_dy": 0.004147239960730076,
      "rmse_mean": 0.01167225744575262,
      "rotation_flip": 0.002378525212407112,
      "sparse_tokens": 32201.0,
      "step": 712,
      "turn_loss": 0.08648107200860977,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.03312581304590225,
      "grad_norm": 0.7750660181045532,
      "learning_rate": 9.938854693545286e-06,
      "loss": 0.1589,
      "mae_dtheta": 0.03138195723295212,
      "mae_dx": 0.010266177356243134,
      "mae_dy": 0.004286999348551035,
      "pose_mae_dtheta": 0.23937267065048218,
      "pose_mae_dx": 0.07815833389759064,
      "pose_mae_dy": 0.03656477481126785,
      "pose_rmse_dtheta": 0.41812291741371155,
      "pose_rmse_dx": 0.191134512424469,
      "pose_rmse_dy": 0.08224134892225266,
      "pose_rmse_mean": 0.23049961030483246,
      "rmse_dtheta": 0.04735559597611427,
      "rmse_dx": 0.02225142903625965,
      "rmse_dy": 0.008355947211384773,
      "rmse_mean": 0.025987658649683,
      "rotation_flip": 0.004761904943734407,
      "sparse_tokens": 6043.0,
      "step": 713,
      "turn_loss": 0.2593613266944885,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.03317227281174503,
      "grad_norm": 0.5143092274665833,
      "learning_rate": 9.938648370941653e-06,
      "loss": 0.1407,
      "mae_dtheta": 0.03771687299013138,
      "mae_dx": 0.012924144975841045,
      "mae_dy": 0.004971169400960207,
      "pose_mae_dtheta": 0.33023154735565186,
      "pose_mae_dx": 0.09748563915491104,
      "pose_mae_dy": 0.07435279339551926,
      "pose_rmse_dtheta": 0.55803382396698,
      "pose_rmse_dx": 0.21183811128139496,
      "pose_rmse_dy": 0.17425280809402466,
      "pose_rmse_mean": 0.31470826268196106,
      "rmse_dtheta": 0.05692030116915703,
      "rmse_dx": 0.025910882279276848,
      "rmse_dy": 0.0096018360927701,
      "rmse_mean": 0.03081100806593895,
      "rotation_flip": 0.011312217451632023,
      "sparse_tokens": 14012.0,
      "step": 714,
      "turn_loss": 0.28928568959236145,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.03321873257758781,
      "grad_norm": 0.5352361798286438,
      "learning_rate": 9.938441702975689e-06,
      "loss": 0.1102,
      "mae_dtheta": 0.009817861951887608,
      "mae_dx": 0.0023938866797834635,
      "mae_dy": 0.0023506279103457928,
      "pose_mae_dtheta": 0.07450905442237854,
      "pose_mae_dx": 0.023842643946409225,
      "pose_mae_dy": 0.034537654370069504,
      "pose_rmse_dtheta": 0.19853278994560242,
      "pose_rmse_dx": 0.05318082123994827,
      "pose_rmse_dy": 0.08274110406637192,
      "pose_rmse_mean": 0.11148490756750107,
      "rmse_dtheta": 0.021996622905135155,
      "rmse_dx": 0.006616602186113596,
      "rmse_dy": 0.005002169869840145,
      "rmse_mean": 0.011205132119357586,
      "rotation_flip": 0.0015117158181965351,
      "sparse_tokens": 32121.0,
      "step": 715,
      "turn_loss": 0.09441535919904709,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.03326519234343059,
      "grad_norm": 0.43695569038391113,
      "learning_rate": 9.938234689661846e-06,
      "loss": 0.1487,
      "mae_dtheta": 0.011857843957841396,
      "mae_dx": 0.0026966286823153496,
      "mae_dy": 0.003220086684450507,
      "pose_mae_dtheta": 0.08248987048864365,
      "pose_mae_dx": 0.030985152348876,
      "pose_mae_dy": 0.035443611443042755,
      "pose_rmse_dtheta": 0.17081186175346375,
      "pose_rmse_dx": 0.07923091948032379,
      "pose_rmse_dy": 0.07508713752031326,
      "pose_rmse_mean": 0.108376644551754,
      "rmse_dtheta": 0.022999467328190804,
      "rmse_dx": 0.007650340907275677,
      "rmse_dy": 0.007032084744423628,
      "rmse_mean": 0.012560631148517132,
      "rotation_flip": 0.007793128024786711,
      "sparse_tokens": 32137.0,
      "step": 716,
      "turn_loss": 0.11888469010591507,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.03331165210927337,
      "grad_norm": 0.6998282670974731,
      "learning_rate": 9.938027331014602e-06,
      "loss": 0.2298,
      "mae_dtheta": 0.013113025575876236,
      "mae_dx": 0.0022554865572601557,
      "mae_dy": 0.003252672730013728,
      "pose_mae_dtheta": 0.08605170249938965,
      "pose_mae_dx": 0.03097827546298504,
      "pose_mae_dy": 0.034774210304021835,
      "pose_rmse_dtheta": 0.22023874521255493,
      "pose_rmse_dx": 0.07035475224256516,
      "pose_rmse_dy": 0.08662272989749908,
      "pose_rmse_mean": 0.1257387399673462,
      "rmse_dtheta": 0.027612579986453056,
      "rmse_dx": 0.0054922220297157764,
      "rmse_dy": 0.006193515378981829,
      "rmse_mean": 0.013099439442157745,
      "rotation_flip": 0.005547337234020233,
      "sparse_tokens": 32105.0,
      "step": 717,
      "turn_loss": 0.1147308349609375,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.03335811187511615,
      "grad_norm": 0.8117398023605347,
      "learning_rate": 9.937819627048454e-06,
      "loss": 0.1849,
      "mae_dtheta": 0.014402837492525578,
      "mae_dx": 0.0023662776220589876,
      "mae_dy": 0.003118163673207164,
      "pose_mae_dtheta": 0.10194480419158936,
      "pose_mae_dx": 0.03654535487294197,
      "pose_mae_dy": 0.04251442104578018,
      "pose_rmse_dtheta": 0.22174429893493652,
      "pose_rmse_dx": 0.0846942663192749,
      "pose_rmse_dy": 0.0957193598151207,
      "pose_rmse_mean": 0.13405264914035797,
      "rmse_dtheta": 0.027367187663912773,
      "rmse_dx": 0.006669315975159407,
      "rmse_dy": 0.006455662194639444,
      "rmse_mean": 0.013497388921678066,
      "rotation_flip": 0.006303915288299322,
      "sparse_tokens": 32121.0,
      "step": 718,
      "turn_loss": 0.10437953472137451,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.03340457164095893,
      "grad_norm": 0.6508180499076843,
      "learning_rate": 9.93761157777793e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.010225360281765461,
      "mae_dx": 0.0020337908063083887,
      "mae_dy": 0.00035128326271660626,
      "pose_mae_dtheta": 0.07543612271547318,
      "pose_mae_dx": 0.017936712130904198,
      "pose_mae_dy": 0.006458335556089878,
      "pose_rmse_dtheta": 0.27253761887550354,
      "pose_rmse_dx": 0.03887128829956055,
      "pose_rmse_dy": 0.018273411318659782,
      "pose_rmse_mean": 0.10989411175251007,
      "rmse_dtheta": 0.0332845114171505,
      "rmse_dx": 0.005275334231555462,
      "rmse_dy": 0.0006499267765320837,
      "rmse_mean": 0.013069923967123032,
      "rotation_flip": 0.0021574972197413445,
      "sparse_tokens": 32249.0,
      "step": 719,
      "turn_loss": 0.058176588267087936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.03345103140680171,
      "grad_norm": 0.7383769750595093,
      "learning_rate": 9.93740318321758e-06,
      "loss": 0.1376,
      "mae_dtheta": 0.0117478733882308,
      "mae_dx": 0.0022172415629029274,
      "mae_dy": 0.0032453059684485197,
      "pose_mae_dtheta": 0.0876116156578064,
      "pose_mae_dx": 0.036545280367136,
      "pose_mae_dy": 0.04371435195207596,
      "pose_rmse_dtheta": 0.19839037954807281,
      "pose_rmse_dx": 0.10969260334968567,
      "pose_rmse_dy": 0.10752160102128983,
      "pose_rmse_mean": 0.13853487372398376,
      "rmse_dtheta": 0.023899180814623833,
      "rmse_dx": 0.007266426458954811,
      "rmse_dy": 0.00740048848092556,
      "rmse_mean": 0.012855365872383118,
      "rotation_flip": 0.004271476063877344,
      "sparse_tokens": 32041.0,
      "step": 720,
      "turn_loss": 0.10584232211112976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.03349749117264449,
      "grad_norm": 0.5425574779510498,
      "learning_rate": 9.937194443381972e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.017381375655531883,
      "mae_dx": 0.0044818841852247715,
      "mae_dy": 0.004784096963703632,
      "pose_mae_dtheta": 0.1307707577943802,
      "pose_mae_dx": 0.04335736483335495,
      "pose_mae_dy": 0.04845045506954193,
      "pose_rmse_dtheta": 0.28660550713539124,
      "pose_rmse_dx": 0.12810495495796204,
      "pose_rmse_dy": 0.10936485230922699,
      "pose_rmse_mean": 0.17469178140163422,
      "rmse_dtheta": 0.0337386317551136,
      "rmse_dx": 0.013674764893949032,
      "rmse_dy": 0.010611802339553833,
      "rmse_mean": 0.019341733306646347,
      "rotation_flip": 0.005181347019970417,
      "sparse_tokens": 32073.0,
      "step": 721,
      "turn_loss": 0.15833891928195953,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.03354395093848727,
      "grad_norm": 0.5638972520828247,
      "learning_rate": 9.93698535828571e-06,
      "loss": 0.1554,
      "mae_dtheta": 0.025673357769846916,
      "mae_dx": 0.006586050149053335,
      "mae_dy": 0.007134156301617622,
      "pose_mae_dtheta": 0.1746896654367447,
      "pose_mae_dx": 0.041596584022045135,
      "pose_mae_dy": 0.10676126182079315,
      "pose_rmse_dtheta": 0.27176564931869507,
      "pose_rmse_dx": 0.06126466020941734,
      "pose_rmse_dy": 0.2028278261423111,
      "pose_rmse_mean": 0.178619384765625,
      "rmse_dtheta": 0.03726744279265404,
      "rmse_dx": 0.015158104710280895,
      "rmse_dy": 0.01115158386528492,
      "rmse_mean": 0.02119237743318081,
      "rotation_flip": 0.014563106931746006,
      "sparse_tokens": 3166.0,
      "step": 722,
      "turn_loss": 0.2794608771800995,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.03359041070433005,
      "grad_norm": 0.5902700424194336,
      "learning_rate": 9.936775927943409e-06,
      "loss": 0.1286,
      "mae_dtheta": 0.010825459845364094,
      "mae_dx": 0.002022842410951853,
      "mae_dy": 0.0026355008594691753,
      "pose_mae_dtheta": 0.07566481828689575,
      "pose_mae_dx": 0.026936940848827362,
      "pose_mae_dy": 0.03388046473264694,
      "pose_rmse_dtheta": 0.14750321209430695,
      "pose_rmse_dx": 0.07069525867700577,
      "pose_rmse_dy": 0.08086570352315903,
      "pose_rmse_mean": 0.09968806803226471,
      "rmse_dtheta": 0.021500520408153534,
      "rmse_dx": 0.006257252302020788,
      "rmse_dy": 0.005881194490939379,
      "rmse_mean": 0.011212989687919617,
      "rotation_flip": 0.00592467188835144,
      "sparse_tokens": 32089.0,
      "step": 723,
      "turn_loss": 0.10267311334609985,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20710.0,
      "epoch": 0.03363687047017283,
      "grad_norm": 0.5947279930114746,
      "learning_rate": 9.93656615236972e-06,
      "loss": 0.1598,
      "mae_dtheta": 0.040923479944467545,
      "mae_dx": 0.016549838706851006,
      "mae_dy": 0.0059455810114741325,
      "pose_mae_dtheta": 0.3244708478450775,
      "pose_mae_dx": 0.13923779129981995,
      "pose_mae_dy": 0.07041898369789124,
      "pose_rmse_dtheta": 0.5444664359092712,
      "pose_rmse_dx": 0.29206764698028564,
      "pose_rmse_dy": 0.18861226737499237,
      "pose_rmse_mean": 0.3417154550552368,
      "rmse_dtheta": 0.06019363924860954,
      "rmse_dx": 0.03028692677617073,
      "rmse_dy": 0.015684647485613823,
      "rmse_mean": 0.03538840636610985,
      "rotation_flip": 0.009656652808189392,
      "sparse_tokens": 17326.0,
      "step": 724,
      "turn_loss": 0.3613385856151581,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 34064.0,
      "epoch": 0.03368333023601561,
      "grad_norm": 0.6747269034385681,
      "learning_rate": 9.936356031579308e-06,
      "loss": 0.2019,
      "mae_dtheta": 0.03224993124604225,
      "mae_dx": 0.012834141962230206,
      "mae_dy": 0.003964308183640242,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6747269034385681,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 145.13966369628906,
      "model/head/act_norm_mean": 101.18571428571428,
      "model/head/act_norm_min": 60.47007751464844,
      "model/head/act_over_embed": 69.5357701727252,
      "model/head/grad_frac": 0.1005428209900856,
      "model/head/grad_norm": 0.06783894449472427,
      "model/head/grad_zero_frac": 0.00021955206466373056,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6752604166666667,
      "model/head/update_ratio": 0.0011852619936689734,
      "model/head/weight_delta": 2.9934346675872803,
      "model/head/weight_delta_rel": 0.05251371115446091,
      "model/head/weight_norm": 57.23540115356445,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41079312562942505,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41073129761893795,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4106685221195221,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2822583930507266,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11075284332036972,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07472792267799377,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5312868514150944,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0024369857273995876,
      "model/modality_embedder.encoders.pose/weight_delta": 0.8902130126953125,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.029086032882332802,
      "model/modality_embedder.encoders.pose/weight_norm": 30.664079666137695,
      "model/modality_embedder/grad_frac": 0.11075284332036972,
      "model/modality_embedder/grad_norm": 0.07472792267799377,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5312868514150944,
      "model/modality_embedder/update_ratio": 0.0024369857273995876,
      "model/modality_embedder/weight_delta": 0.8902130126953125,
      "model/modality_embedder/weight_delta_rel": 0.029086032882332802,
      "model/modality_embedder/weight_norm": 30.664079666137695,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.5818099975586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.433394746787602,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.090580940246582,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.416438894743054,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1044732853770256,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.07049093395471573,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0025636195205152035,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.4386352598667145,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.015984132885932922,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.496644973754883,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.9656753540039,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.381809807256236,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.336233139038086,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.06819860349879,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08797620236873627,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05935990810394287,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002048899419605732,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.5198248624801636,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.01800713874399662,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.97160530090332,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 76.56768035888672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.08321050642479,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.43306827545166,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.23741709273173,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08008834719657898,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05403776466846466,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018078171415254474,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.5347139239311218,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.017954692244529724,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.89116668701172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.90425109863281,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.052402210884352,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.877192497253418,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.590664067899535,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07372083514928818,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04974142834544182,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016953112790361047,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.4498210549354553,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.015372749418020248,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.340587615966797,
      "model/normalizer/grad_frac": 0.350338339805603,
      "model/normalizer/grad_norm": 0.23638270795345306,
      "model/normalizer/grad_zero_frac": 0.00021743986872024834,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0030399577226489782,
      "model/normalizer/weight_delta": 1.0012931823730469,
      "model/normalizer/weight_delta_rel": 0.012896076776087284,
      "model/normalizer/weight_norm": 77.75855255126953,
      "pose_mae_dtheta": 0.25242283940315247,
      "pose_mae_dx": 0.09990529716014862,
      "pose_mae_dy": 0.04877714440226555,
      "pose_rmse_dtheta": 0.43234413862228394,
      "pose_rmse_dx": 0.22140364348888397,
      "pose_rmse_dy": 0.12102678418159485,
      "pose_rmse_mean": 0.258258193731308,
      "rmse_dtheta": 0.049042604863643646,
      "rmse_dx": 0.024688631296157837,
      "rmse_dy": 0.007729789242148399,
      "rmse_mean": 0.027153676375746727,
      "rotation_flip": 0.011912640184164047,
      "sparse_tokens": 26524.0,
      "step": 725,
      "turn_loss": 0.26524174213409424,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.03372979000185839,
      "grad_norm": 0.4992204010486603,
      "learning_rate": 9.936145565586871e-06,
      "loss": 0.1456,
      "mae_dtheta": 0.03992568328976631,
      "mae_dx": 0.012253984808921814,
      "mae_dy": 0.005475780926644802,
      "pose_mae_dtheta": 0.3175129294395447,
      "pose_mae_dx": 0.0941232368350029,
      "pose_mae_dy": 0.05809655785560608,
      "pose_rmse_dtheta": 0.519251823425293,
      "pose_rmse_dx": 0.19094008207321167,
      "pose_rmse_dy": 0.11686712503433228,
      "pose_rmse_mean": 0.2756863534450531,
      "rmse_dtheta": 0.056585296988487244,
      "rmse_dx": 0.023354526609182358,
      "rmse_dy": 0.009887046180665493,
      "rmse_mean": 0.029942292720079422,
      "rotation_flip": 0.014124293811619282,
      "sparse_tokens": 5648.0,
      "step": 726,
      "turn_loss": 0.3553089499473572,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.03377624976770117,
      "grad_norm": 0.9979928731918335,
      "learning_rate": 9.935934754407125e-06,
      "loss": 0.2143,
      "mae_dtheta": 0.03772357851266861,
      "mae_dx": 0.010079408995807171,
      "mae_dy": 0.00717396242544055,
      "pose_mae_dtheta": 0.3230189383029938,
      "pose_mae_dx": 0.08616983890533447,
      "pose_mae_dy": 0.06299445033073425,
      "pose_rmse_dtheta": 0.5660014748573303,
      "pose_rmse_dx": 0.18920062482357025,
      "pose_rmse_dy": 0.14844198524951935,
      "pose_rmse_mean": 0.30121469497680664,
      "rmse_dtheta": 0.056949958205223083,
      "rmse_dx": 0.021647604182362556,
      "rmse_dy": 0.015453674830496311,
      "rmse_mean": 0.03135041147470474,
      "rotation_flip": 0.0163690485060215,
      "sparse_tokens": 12061.0,
      "step": 727,
      "turn_loss": 0.39432060718536377,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.03382270953354395,
      "grad_norm": 0.6841055750846863,
      "learning_rate": 9.935723598054812e-06,
      "loss": 0.1895,
      "mae_dtheta": 0.04187403619289398,
      "mae_dx": 0.012207132764160633,
      "mae_dy": 0.005723555572330952,
      "pose_mae_dtheta": 0.3465658724308014,
      "pose_mae_dx": 0.10511767119169235,
      "pose_mae_dy": 0.06802733242511749,
      "pose_rmse_dtheta": 0.5905446410179138,
      "pose_rmse_dx": 0.20922400057315826,
      "pose_rmse_dy": 0.16577865183353424,
      "pose_rmse_mean": 0.32184910774230957,
      "rmse_dtheta": 0.05997564271092415,
      "rmse_dx": 0.024011898785829544,
      "rmse_dy": 0.010195896960794926,
      "rmse_mean": 0.03139448165893555,
      "rotation_flip": 0.008994276635348797,
      "sparse_tokens": 19622.0,
      "step": 728,
      "turn_loss": 0.3077951669692993,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.03386916929938673,
      "grad_norm": 1.028657078742981,
      "learning_rate": 9.9355120965447e-06,
      "loss": 0.2775,
      "mae_dtheta": 0.031756747514009476,
      "mae_dx": 0.012113767676055431,
      "mae_dy": 0.004880623891949654,
      "pose_mae_dtheta": 0.21728761494159698,
      "pose_mae_dx": 0.10816314816474915,
      "pose_mae_dy": 0.05478902906179428,
      "pose_rmse_dtheta": 0.3696894347667694,
      "pose_rmse_dx": 0.2174081802368164,
      "pose_rmse_dy": 0.13101477921009064,
      "pose_rmse_mean": 0.23937080800533295,
      "rmse_dtheta": 0.04807322099804878,
      "rmse_dx": 0.023909762501716614,
      "rmse_dy": 0.011034362949430943,
      "rmse_mean": 0.02767244726419449,
      "rotation_flip": 0.017421603202819824,
      "sparse_tokens": 15865.0,
      "step": 729,
      "turn_loss": 0.25264519453048706,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.03391562906522951,
      "grad_norm": 0.5566814541816711,
      "learning_rate": 9.935300249891575e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.010966120287775993,
      "mae_dx": 0.002370162634178996,
      "mae_dy": 0.0023625942412763834,
      "pose_mae_dtheta": 0.08372476696968079,
      "pose_mae_dx": 0.02948615886271,
      "pose_mae_dy": 0.032469742000103,
      "pose_rmse_dtheta": 0.21501204371452332,
      "pose_rmse_dx": 0.10134134441614151,
      "pose_rmse_dy": 0.08580188453197479,
      "pose_rmse_mean": 0.13405176997184753,
      "rmse_dtheta": 0.024711253121495247,
      "rmse_dx": 0.008629913441836834,
      "rmse_dy": 0.005719719920307398,
      "rmse_mean": 0.013020295649766922,
      "rotation_flip": 0.007497116457670927,
      "sparse_tokens": 32041.0,
      "step": 730,
      "turn_loss": 0.07951844483613968,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.03396208883107229,
      "grad_norm": 0.6276096701622009,
      "learning_rate": 9.935088058110256e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.007998946122825146,
      "mae_dx": 0.001766360946930945,
      "mae_dy": 0.0008444433915428817,
      "pose_mae_dtheta": 0.056113384664058685,
      "pose_mae_dx": 0.017414787784218788,
      "pose_mae_dy": 0.011509467847645283,
      "pose_rmse_dtheta": 0.19983221590518951,
      "pose_rmse_dx": 0.04844335839152336,
      "pose_rmse_dy": 0.034122928977012634,
      "pose_rmse_mean": 0.09413284063339233,
      "rmse_dtheta": 0.025183727964758873,
      "rmse_dx": 0.005638116039335728,
      "rmse_dy": 0.0019761070143431425,
      "rmse_mean": 0.010932650417089462,
      "rotation_flip": 0.0012642225483432412,
      "sparse_tokens": 32137.0,
      "step": 731,
      "turn_loss": 0.05497903376817703,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.03400854859691507,
      "grad_norm": 0.9725404977798462,
      "learning_rate": 9.934875521215582e-06,
      "loss": 0.096,
      "mae_dtheta": 0.045652393251657486,
      "mae_dx": 0.01499681081622839,
      "mae_dy": 0.004515748471021652,
      "pose_mae_dtheta": 0.4002193212509155,
      "pose_mae_dx": 0.11758841574192047,
      "pose_mae_dy": 0.03478763625025749,
      "pose_rmse_dtheta": 0.6565636396408081,
      "pose_rmse_dx": 0.268086701631546,
      "pose_rmse_dy": 0.07516710460186005,
      "pose_rmse_mean": 0.3332724869251251,
      "rmse_dtheta": 0.06305752694606781,
      "rmse_dx": 0.028393421322107315,
      "rmse_dy": 0.009523017331957817,
      "rmse_mean": 0.0336579903960228,
      "rotation_flip": 0.003367003286257386,
      "sparse_tokens": 5350.0,
      "step": 732,
      "turn_loss": 0.33978018164634705,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.03405500836275785,
      "grad_norm": 0.8295831084251404,
      "learning_rate": 9.934662639222412e-06,
      "loss": 0.1718,
      "mae_dtheta": 0.04481329396367073,
      "mae_dx": 0.014503823593258858,
      "mae_dy": 0.006150542758405209,
      "pose_mae_dtheta": 0.35323208570480347,
      "pose_mae_dx": 0.12214231491088867,
      "pose_mae_dy": 0.06116669252514839,
      "pose_rmse_dtheta": 0.582100510597229,
      "pose_rmse_dx": 0.25930821895599365,
      "pose_rmse_dy": 0.18032820522785187,
      "pose_rmse_mean": 0.34057900309562683,
      "rmse_dtheta": 0.06262139230966568,
      "rmse_dx": 0.026777101680636406,
      "rmse_dy": 0.014554297551512718,
      "rmse_mean": 0.034650932997465134,
      "rotation_flip": 0.007541478145867586,
      "sparse_tokens": 11994.0,
      "step": 733,
      "turn_loss": 0.40075168013572693,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.03410146812860063,
      "grad_norm": 0.5562266707420349,
      "learning_rate": 9.934449412145636e-06,
      "loss": 0.0859,
      "mae_dtheta": 0.01181887462735176,
      "mae_dx": 0.00238251150585711,
      "mae_dy": 0.0031827359925955534,
      "pose_mae_dtheta": 0.08381398022174835,
      "pose_mae_dx": 0.029831726104021072,
      "pose_mae_dy": 0.038775455206632614,
      "pose_rmse_dtheta": 0.17426089942455292,
      "pose_rmse_dx": 0.07036864012479782,
      "pose_rmse_dy": 0.09590547531843185,
      "pose_rmse_mean": 0.11351167410612106,
      "rmse_dtheta": 0.022617753595113754,
      "rmse_dx": 0.0065355440601706505,
      "rmse_dy": 0.006960796192288399,
      "rmse_mean": 0.0120380325242877,
      "rotation_flip": 0.005384063348174095,
      "sparse_tokens": 32137.0,
      "step": 734,
      "turn_loss": 0.10543360561132431,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.03414792789444341,
      "grad_norm": 0.5288987755775452,
      "learning_rate": 9.934235840000164e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.011674521490931511,
      "mae_dx": 0.003030295018106699,
      "mae_dy": 0.004224173258990049,
      "pose_mae_dtheta": 0.08676432818174362,
      "pose_mae_dx": 0.04535817354917526,
      "pose_mae_dy": 0.03734678775072098,
      "pose_rmse_dtheta": 0.21877114474773407,
      "pose_rmse_dx": 0.1188209131360054,
      "pose_rmse_dy": 0.09137314558029175,
      "pose_rmse_mean": 0.1429884135723114,
      "rmse_dtheta": 0.02507551945745945,
      "rmse_dx": 0.007149377837777138,
      "rmse_dy": 0.009170711040496826,
      "rmse_mean": 0.013798536732792854,
      "rotation_flip": 0.0028641570825129747,
      "sparse_tokens": 32073.0,
      "step": 735,
      "turn_loss": 0.11792416870594025,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.034194387660286193,
      "grad_norm": 0.7084857225418091,
      "learning_rate": 9.934021922800931e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.012245282530784607,
      "mae_dx": 0.003170275129377842,
      "mae_dy": 0.002525097457692027,
      "pose_mae_dtheta": 0.09727796912193298,
      "pose_mae_dx": 0.03008922189474106,
      "pose_mae_dy": 0.030796144157648087,
      "pose_rmse_dtheta": 0.2348664402961731,
      "pose_rmse_dx": 0.07449859380722046,
      "pose_rmse_dy": 0.0755205899477005,
      "pose_rmse_mean": 0.12829521298408508,
      "rmse_dtheta": 0.02636490762233734,
      "rmse_dx": 0.008688794448971748,
      "rmse_dy": 0.005904842168092728,
      "rmse_mean": 0.013652848079800606,
      "rotation_flip": 0.004513746593147516,
      "sparse_tokens": 32153.0,
      "step": 736,
      "turn_loss": 0.1141422837972641,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.03424084742612897,
      "grad_norm": 0.8535438179969788,
      "learning_rate": 9.933807660562898e-06,
      "loss": 0.1241,
      "mae_dtheta": 0.013241028413176537,
      "mae_dx": 0.0024589330423623323,
      "mae_dy": 0.002794743748381734,
      "pose_mae_dtheta": 0.0913943275809288,
      "pose_mae_dx": 0.027199866250157356,
      "pose_mae_dy": 0.03348619118332863,
      "pose_rmse_dtheta": 0.21484901010990143,
      "pose_rmse_dx": 0.06897199153900146,
      "pose_rmse_dy": 0.07846932113170624,
      "pose_rmse_mean": 0.12076344341039658,
      "rmse_dtheta": 0.02647174336016178,
      "rmse_dx": 0.006836713291704655,
      "rmse_dy": 0.006616145372390747,
      "rmse_mean": 0.013308200985193253,
      "rotation_flip": 0.004986400716006756,
      "sparse_tokens": 32089.0,
      "step": 737,
      "turn_loss": 0.11825153976678848,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.034287307191971754,
      "grad_norm": 0.6259469985961914,
      "learning_rate": 9.933593053301044e-06,
      "loss": 0.1635,
      "mae_dtheta": 0.009477822110056877,
      "mae_dx": 0.0024466789327561855,
      "mae_dy": 0.0018911522347480059,
      "pose_mae_dtheta": 0.06793578714132309,
      "pose_mae_dx": 0.025688152760267258,
      "pose_mae_dy": 0.02735908329486847,
      "pose_rmse_dtheta": 0.1627447009086609,
      "pose_rmse_dx": 0.07249635457992554,
      "pose_rmse_dy": 0.07573676854372025,
      "pose_rmse_mean": 0.10365927219390869,
      "rmse_dtheta": 0.02172328531742096,
      "rmse_dx": 0.007145483512431383,
      "rmse_dy": 0.004760413896292448,
      "rmse_mean": 0.011209728196263313,
      "rotation_flip": 0.003960396163165569,
      "sparse_tokens": 32089.0,
      "step": 738,
      "turn_loss": 0.09417886286973953,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.03433376695781453,
      "grad_norm": 0.7009466886520386,
      "learning_rate": 9.933378101030382e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.050379663705825806,
      "mae_dx": 0.01053712610155344,
      "mae_dy": 0.0042374408803880215,
      "pose_mae_dtheta": 0.45842233300209045,
      "pose_mae_dx": 0.06989695131778717,
      "pose_mae_dy": 0.04157949611544609,
      "pose_rmse_dtheta": 0.740135669708252,
      "pose_rmse_dx": 0.17633047699928284,
      "pose_rmse_dy": 0.14520399272441864,
      "pose_rmse_mean": 0.3538900315761566,
      "rmse_dtheta": 0.07079442590475082,
      "rmse_dx": 0.022467324510216713,
      "rmse_dy": 0.012102599255740643,
      "rmse_mean": 0.03512144833803177,
      "rotation_flip": 0.013368983753025532,
      "sparse_tokens": 5850.0,
      "step": 739,
      "turn_loss": 0.32951992750167847,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.034380226723657314,
      "grad_norm": 0.5691273808479309,
      "learning_rate": 9.933162803765941e-06,
      "loss": 0.1352,
      "mae_dtheta": 0.03967815265059471,
      "mae_dx": 0.0063171605579555035,
      "mae_dy": 0.003810737282037735,
      "pose_mae_dtheta": 0.27951931953430176,
      "pose_mae_dx": 0.058603398501873016,
      "pose_mae_dy": 0.040192510932683945,
      "pose_rmse_dtheta": 0.508465051651001,
      "pose_rmse_dx": 0.11918824166059494,
      "pose_rmse_dy": 0.0930088683962822,
      "pose_rmse_mean": 0.24022072553634644,
      "rmse_dtheta": 0.06162341684103012,
      "rmse_dx": 0.016003794968128204,
      "rmse_dy": 0.006438641808927059,
      "rmse_mean": 0.028021952137351036,
      "rotation_flip": 0.0150602413341403,
      "sparse_tokens": 7059.0,
      "step": 740,
      "turn_loss": 0.2519429922103882,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.03442668648950009,
      "grad_norm": 0.5335209369659424,
      "learning_rate": 9.932947161522779e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.028588278219103813,
      "mae_dx": 0.014626435935497284,
      "mae_dy": 0.005396191030740738,
      "pose_mae_dtheta": 0.2464885115623474,
      "pose_mae_dx": 0.11554192006587982,
      "pose_mae_dy": 0.10717418789863586,
      "pose_rmse_dtheta": 0.4000081419944763,
      "pose_rmse_dx": 0.2509106993675232,
      "pose_rmse_dy": 0.2274743616580963,
      "pose_rmse_mean": 0.2927977442741394,
      "rmse_dtheta": 0.04387916624546051,
      "rmse_dx": 0.028782343491911888,
      "rmse_dy": 0.00968335010111332,
      "rmse_mean": 0.02744828723371029,
      "rotation_flip": 0.004514672793447971,
      "sparse_tokens": 7693.0,
      "step": 741,
      "turn_loss": 0.24869588017463684,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.034473146255342875,
      "grad_norm": 0.5634315609931946,
      "learning_rate": 9.932731174315973e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.03606212139129639,
      "mae_dx": 0.00932290218770504,
      "mae_dy": 0.002183695090934634,
      "pose_mae_dtheta": 0.2650162875652313,
      "pose_mae_dx": 0.07374037057161331,
      "pose_mae_dy": 0.03135579824447632,
      "pose_rmse_dtheta": 0.5041974186897278,
      "pose_rmse_dx": 0.20400914549827576,
      "pose_rmse_dy": 0.0865587517619133,
      "pose_rmse_mean": 0.26492178440093994,
      "rmse_dtheta": 0.05931583791971207,
      "rmse_dx": 0.021578548476099968,
      "rmse_dy": 0.004506990779191256,
      "rmse_mean": 0.028467126190662384,
      "rotation_flip": 0.02826855145394802,
      "sparse_tokens": 5039.0,
      "step": 742,
      "turn_loss": 0.1632077395915985,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.03451960602118565,
      "grad_norm": 0.42819565534591675,
      "learning_rate": 9.932514842160628e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.01357349008321762,
      "mae_dx": 0.002495512831956148,
      "mae_dy": 0.0029472748283296824,
      "pose_mae_dtheta": 0.10071643441915512,
      "pose_mae_dx": 0.02804654650390148,
      "pose_mae_dy": 0.03539956733584404,
      "pose_rmse_dtheta": 0.22614765167236328,
      "pose_rmse_dx": 0.07720188796520233,
      "pose_rmse_dy": 0.07363518327474594,
      "pose_rmse_mean": 0.12566158175468445,
      "rmse_dtheta": 0.02762671746313572,
      "rmse_dx": 0.007769985124468803,
      "rmse_dy": 0.0068838633596897125,
      "rmse_mean": 0.014093521982431412,
      "rotation_flip": 0.0025010420940816402,
      "sparse_tokens": 32073.0,
      "step": 743,
      "turn_loss": 0.11196969449520111,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.034566065787028435,
      "grad_norm": 0.4054451584815979,
      "learning_rate": 9.932298165071872e-06,
      "loss": 0.0948,
      "mae_dtheta": 0.008580593392252922,
      "mae_dx": 0.0024545288179069757,
      "mae_dy": 0.0013914526207372546,
      "pose_mae_dtheta": 0.06363224238157272,
      "pose_mae_dx": 0.025340741500258446,
      "pose_mae_dy": 0.02194937877357006,
      "pose_rmse_dtheta": 0.15458478033542633,
      "pose_rmse_dx": 0.06999095529317856,
      "pose_rmse_dy": 0.04943031817674637,
      "pose_rmse_mean": 0.09133534878492355,
      "rmse_dtheta": 0.02042148821055889,
      "rmse_dx": 0.007532586343586445,
      "rmse_dy": 0.0026501924730837345,
      "rmse_mean": 0.01020142249763012,
      "rotation_flip": 0.0028490028344094753,
      "sparse_tokens": 32153.0,
      "step": 744,
      "turn_loss": 0.057854995131492615,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.03461252555287121,
      "grad_norm": 0.5313278436660767,
      "learning_rate": 9.93208114306486e-06,
      "loss": 0.1178,
      "mae_dtheta": 0.01127528864890337,
      "mae_dx": 0.0021152300760149956,
      "mae_dy": 0.0021636008750647306,
      "pose_mae_dtheta": 0.07865498214960098,
      "pose_mae_dx": 0.02444441057741642,
      "pose_mae_dy": 0.031338196247816086,
      "pose_rmse_dtheta": 0.16351835429668427,
      "pose_rmse_dx": 0.06275776773691177,
      "pose_rmse_dy": 0.07500573992729187,
      "pose_rmse_mean": 0.1004272922873497,
      "rmse_dtheta": 0.022485554218292236,
      "rmse_dx": 0.006503453012555838,
      "rmse_dy": 0.004271414130926132,
      "rmse_mean": 0.011086806654930115,
      "rotation_flip": 0.004356435500085354,
      "sparse_tokens": 32137.0,
      "step": 745,
      "turn_loss": 0.08353227376937866,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.034658985318713996,
      "grad_norm": 0.43257761001586914,
      "learning_rate": 9.931863776154766e-06,
      "loss": 0.1454,
      "mae_dtheta": 0.04460782930254936,
      "mae_dx": 0.01294372882694006,
      "mae_dy": 0.004503021016716957,
      "pose_mae_dtheta": 0.3611906170845032,
      "pose_mae_dx": 0.10775284469127655,
      "pose_mae_dy": 0.046127740293741226,
      "pose_rmse_dtheta": 0.6120913028717041,
      "pose_rmse_dx": 0.22164559364318848,
      "pose_rmse_dy": 0.14092272520065308,
      "pose_rmse_mean": 0.3248865604400635,
      "rmse_dtheta": 0.06516867876052856,
      "rmse_dx": 0.02496948465704918,
      "rmse_dy": 0.011077267117798328,
      "rmse_mean": 0.033738479018211365,
      "rotation_flip": 0.011560693383216858,
      "sparse_tokens": 12674.0,
      "step": 746,
      "turn_loss": 0.34224337339401245,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.03470544508455677,
      "grad_norm": 0.44145846366882324,
      "learning_rate": 9.93164606435679e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.01217175554484129,
      "mae_dx": 0.0019458899041637778,
      "mae_dy": 0.0022593617904931307,
      "pose_mae_dtheta": 0.08599887788295746,
      "pose_mae_dx": 0.026515576988458633,
      "pose_mae_dy": 0.030323928222060204,
      "pose_rmse_dtheta": 0.21680660545825958,
      "pose_rmse_dx": 0.06783068180084229,
      "pose_rmse_dy": 0.0700967088341713,
      "pose_rmse_mean": 0.11824466288089752,
      "rmse_dtheta": 0.025496792048215866,
      "rmse_dx": 0.0060379281640052795,
      "rmse_dy": 0.004668785259127617,
      "rmse_mean": 0.012067834846675396,
      "rotation_flip": 0.002421307610347867,
      "sparse_tokens": 32073.0,
      "step": 747,
      "turn_loss": 0.09203056991100311,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.034751904850399556,
      "grad_norm": 0.587018609046936,
      "learning_rate": 9.931428007686158e-06,
      "loss": 0.1561,
      "mae_dtheta": 0.02673369273543358,
      "mae_dx": 0.010060618631541729,
      "mae_dy": 0.004952194169163704,
      "pose_mae_dtheta": 0.19429446756839752,
      "pose_mae_dx": 0.08821748942136765,
      "pose_mae_dy": 0.05416687950491905,
      "pose_rmse_dtheta": 0.36189520359039307,
      "pose_rmse_dx": 0.20266716182231903,
      "pose_rmse_dy": 0.11474880576133728,
      "pose_rmse_mean": 0.2264370620250702,
      "rmse_dtheta": 0.04358016327023506,
      "rmse_dx": 0.0216286089271307,
      "rmse_dy": 0.01116987969726324,
      "rmse_mean": 0.025459550321102142,
      "rotation_flip": 0.011473963037133217,
      "sparse_tokens": 21889.0,
      "step": 748,
      "turn_loss": 0.25009989738464355,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.03479836461624233,
      "grad_norm": 0.5298923254013062,
      "learning_rate": 9.93120960615812e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.00913449376821518,
      "mae_dx": 0.001520325429737568,
      "mae_dy": 0.0014469769084826112,
      "pose_mae_dtheta": 0.06411949545145035,
      "pose_mae_dx": 0.017808543518185616,
      "pose_mae_dy": 0.024616705253720284,
      "pose_rmse_dtheta": 0.18123014271259308,
      "pose_rmse_dx": 0.03917046636343002,
      "pose_rmse_dy": 0.055438026785850525,
      "pose_rmse_mean": 0.09194620698690414,
      "rmse_dtheta": 0.02275150641798973,
      "rmse_dx": 0.004479135386645794,
      "rmse_dy": 0.0030237557366490364,
      "rmse_mean": 0.010084799490869045,
      "rotation_flip": 0.005288852844387293,
      "sparse_tokens": 32137.0,
      "step": 749,
      "turn_loss": 0.06434094905853271,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.03484482438208512,
      "grad_norm": 0.40809008479118347,
      "learning_rate": 9.930990859787945e-06,
      "loss": 0.1088,
      "mae_dtheta": 0.013173467479646206,
      "mae_dx": 0.0024449715856462717,
      "mae_dy": 0.0029840634670108557,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4080899953842163,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.18946838378906,
      "model/head/act_norm_mean": 109.84927398989899,
      "model/head/act_norm_min": 62.54623031616211,
      "model/head/act_over_embed": 75.48944951096477,
      "model/head/grad_frac": 0.12133193761110306,
      "model/head/grad_norm": 0.049514349550008774,
      "model/head/grad_zero_frac": 0.0002125720784533769,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.678646819760101,
      "model/head/update_ratio": 0.0008649680530652404,
      "model/head/weight_delta": 3.040149688720703,
      "model/head/weight_delta_rel": 0.05333323031663895,
      "model/head/weight_norm": 57.244136810302734,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41103222966194153,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41095509847005207,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4108913838863373,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2824121910908688,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07958612591028214,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03247830271720886,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5328038194444444,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010591052705422044,
      "model/modality_embedder.encoders.pose/weight_delta": 0.9133918285369873,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.02984335832297802,
      "model/modality_embedder.encoders.pose/weight_norm": 30.665794372558594,
      "model/modality_embedder/grad_frac": 0.07958612591028214,
      "model/modality_embedder/grad_norm": 0.03247830271720886,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5328038194444444,
      "model/modality_embedder/update_ratio": 0.0010591052705422044,
      "model/modality_embedder/weight_delta": 0.9133918285369873,
      "model/modality_embedder/weight_delta_rel": 0.02984335832297802,
      "model/modality_embedder/weight_norm": 30.665794372558594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.38713836669922,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.29723825557159,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.998942375183105,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.010080241409756,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11694817990064621,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.047725383192300797,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017356622265651822,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.44948139786720276,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.016379373148083687,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.496931076049805,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.6362075805664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.434671616963282,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.382011413574219,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.791735096177035,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09097258001565933,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03712499886751175,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012813014909625053,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.5339736342430115,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.01849726401269436,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.974445343017578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.4357681274414,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.399440836940837,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.646637916564941,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.141942898604857,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09027734398841858,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03684128075838089,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012323481496423483,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.5514760613441467,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.01851753331720829,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.89518928527832,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.2256088256836,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.28299112153279,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.668150901794434,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.43633628825204,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09406298398971558,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.038386162370443344,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013081562938168645,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.4647504687309265,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.015882965177297592,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.343713760375977,
      "model/normalizer/grad_frac": 0.5052244663238525,
      "model/normalizer/grad_norm": 0.20617704093456268,
      "model/normalizer/grad_zero_frac": 0.00016189816233236343,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002651375252753496,
      "model/normalizer/weight_delta": 1.0304450988769531,
      "model/normalizer/weight_delta_rel": 0.01327153667807579,
      "model/normalizer/weight_norm": 77.76229858398438,
      "pose_mae_dtheta": 0.09191723167896271,
      "pose_mae_dx": 0.027156412601470947,
      "pose_mae_dy": 0.036230314522981644,
      "pose_rmse_dtheta": 0.20181713998317719,
      "pose_rmse_dx": 0.07943039387464523,
      "pose_rmse_dy": 0.09905270487070084,
      "pose_rmse_mean": 0.12676674127578735,
      "rmse_dtheta": 0.02670072764158249,
      "rmse_dx": 0.00766780087724328,
      "rmse_dy": 0.007536237593740225,
      "rmse_mean": 0.013968255370855331,
      "rotation_flip": 0.007134363986551762,
      "sparse_tokens": 32121.0,
      "step": 750,
      "turn_loss": 0.12878116965293884,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.034891284147927894,
      "grad_norm": 1.3460968732833862,
      "learning_rate": 9.930771768590934e-06,
      "loss": 0.2809,
      "mae_dtheta": 0.026828637346625328,
      "mae_dx": 0.009676920250058174,
      "mae_dy": 0.004987792111933231,
      "pose_mae_dtheta": 0.22158515453338623,
      "pose_mae_dx": 0.07520537078380585,
      "pose_mae_dy": 0.06287636607885361,
      "pose_rmse_dtheta": 0.4231610894203186,
      "pose_rmse_dx": 0.1826288402080536,
      "pose_rmse_dy": 0.14577221870422363,
      "pose_rmse_mean": 0.2505207061767578,
      "rmse_dtheta": 0.04373190924525261,
      "rmse_dx": 0.021540947258472443,
      "rmse_dy": 0.009534977376461029,
      "rmse_mean": 0.024935944005846977,
      "rotation_flip": 0.02282157726585865,
      "sparse_tokens": 8690.0,
      "step": 751,
      "turn_loss": 0.2691548764705658,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.03493774391377068,
      "grad_norm": 0.761507511138916,
      "learning_rate": 9.930552332582406e-06,
      "loss": 0.1682,
      "mae_dtheta": 0.032764095813035965,
      "mae_dx": 0.014583096839487553,
      "mae_dy": 0.006987506523728371,
      "pose_mae_dtheta": 0.2807808220386505,
      "pose_mae_dx": 0.10712376236915588,
      "pose_mae_dy": 0.09888236224651337,
      "pose_rmse_dtheta": 0.44163978099823,
      "pose_rmse_dx": 0.24205461144447327,
      "pose_rmse_dy": 0.2101808786392212,
      "pose_rmse_mean": 0.2979584336280823,
      "rmse_dtheta": 0.04682549834251404,
      "rmse_dx": 0.027725638821721077,
      "rmse_dy": 0.011670935899019241,
      "rmse_mean": 0.028740689158439636,
      "rotation_flip": 0.012077294290065765,
      "sparse_tokens": 7913.0,
      "step": 752,
      "turn_loss": 0.2744406461715698,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.034984203679613454,
      "grad_norm": 0.6447066068649292,
      "learning_rate": 9.930332551777709e-06,
      "loss": 0.1648,
      "mae_dtheta": 0.016010580584406853,
      "mae_dx": 0.0033463542349636555,
      "mae_dy": 0.004061475396156311,
      "pose_mae_dtheta": 0.11419633030891418,
      "pose_mae_dx": 0.04664411395788193,
      "pose_mae_dy": 0.054559748619794846,
      "pose_rmse_dtheta": 0.26054298877716064,
      "pose_rmse_dx": 0.11182750761508942,
      "pose_rmse_dy": 0.14471067488193512,
      "pose_rmse_mean": 0.1723603904247284,
      "rmse_dtheta": 0.03050469607114792,
      "rmse_dx": 0.010002491064369678,
      "rmse_dy": 0.009845675900578499,
      "rmse_mean": 0.016784287989139557,
      "rotation_flip": 0.006415094248950481,
      "sparse_tokens": 32089.0,
      "step": 753,
      "turn_loss": 0.1522529125213623,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.03503066344545624,
      "grad_norm": 0.4666442275047302,
      "learning_rate": 9.930112426192208e-06,
      "loss": 0.1254,
      "mae_dtheta": 0.036504779011011124,
      "mae_dx": 0.01536710374057293,
      "mae_dy": 0.00463078124448657,
      "pose_mae_dtheta": 0.2733529508113861,
      "pose_mae_dx": 0.11328774690628052,
      "pose_mae_dy": 0.056338440626859665,
      "pose_rmse_dtheta": 0.4325689375400543,
      "pose_rmse_dx": 0.2525191009044647,
      "pose_rmse_dy": 0.1187659278512001,
      "pose_rmse_mean": 0.2679513394832611,
      "rmse_dtheta": 0.05201396718621254,
      "rmse_dx": 0.027983492240309715,
      "rmse_dy": 0.007465500384569168,
      "rmse_mean": 0.029154321178793907,
      "rotation_flip": 0.009615384973585606,
      "sparse_tokens": 7824.0,
      "step": 754,
      "turn_loss": 0.27648255228996277,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.035077123211299015,
      "grad_norm": 0.8177797198295593,
      "learning_rate": 9.9298919558413e-06,
      "loss": 0.1894,
      "mae_dtheta": 0.03011963702738285,
      "mae_dx": 0.010458527132868767,
      "mae_dy": 0.005898378789424896,
      "pose_mae_dtheta": 0.23044578731060028,
      "pose_mae_dx": 0.08986255526542664,
      "pose_mae_dy": 0.06385865807533264,
      "pose_rmse_dtheta": 0.3955730199813843,
      "pose_rmse_dx": 0.2055327296257019,
      "pose_rmse_dy": 0.1523895114660263,
      "pose_rmse_mean": 0.25116509199142456,
      "rmse_dtheta": 0.04674083739519119,
      "rmse_dx": 0.023068632930517197,
      "rmse_dy": 0.01291270088404417,
      "rmse_mean": 0.027574054896831512,
      "rotation_flip": 0.01413427572697401,
      "sparse_tokens": 15036.0,
      "step": 755,
      "turn_loss": 0.24803052842617035,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0351235829771418,
      "grad_norm": 0.5409546494483948,
      "learning_rate": 9.9296711407404e-06,
      "loss": 0.1287,
      "mae_dtheta": 0.011059574782848358,
      "mae_dx": 0.0018652480794116855,
      "mae_dy": 0.0027222896460443735,
      "pose_mae_dtheta": 0.0775597095489502,
      "pose_mae_dx": 0.023972351104021072,
      "pose_mae_dy": 0.03392377123236656,
      "pose_rmse_dtheta": 0.17425866425037384,
      "pose_rmse_dx": 0.058723799884319305,
      "pose_rmse_dy": 0.07212124764919281,
      "pose_rmse_mean": 0.10170124471187592,
      "rmse_dtheta": 0.0224001407623291,
      "rmse_dx": 0.0053858328610658646,
      "rmse_dy": 0.005650071892887354,
      "rmse_mean": 0.011145348660647869,
      "rotation_flip": 0.004597701132297516,
      "sparse_tokens": 32089.0,
      "step": 756,
      "turn_loss": 0.08805648982524872,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.035170042742984575,
      "grad_norm": 0.9754475355148315,
      "learning_rate": 9.929449980904952e-06,
      "loss": 0.1063,
      "mae_dtheta": 0.03730161860585213,
      "mae_dx": 0.008123267441987991,
      "mae_dy": 0.014084060676395893,
      "pose_mae_dtheta": 0.3301317095756531,
      "pose_mae_dx": 0.08336816728115082,
      "pose_mae_dy": 0.22350050508975983,
      "pose_rmse_dtheta": 0.554060161113739,
      "pose_rmse_dx": 0.2080066055059433,
      "pose_rmse_dy": 0.4657747149467468,
      "pose_rmse_mean": 0.4092805087566376,
      "rmse_dtheta": 0.05441870540380478,
      "rmse_dx": 0.018321817740797997,
      "rmse_dy": 0.02682485431432724,
      "rmse_mean": 0.033188462257385254,
      "rotation_flip": 0.02985074557363987,
      "sparse_tokens": 8772.0,
      "step": 757,
      "turn_loss": 0.2502671778202057,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.03521650250882736,
      "grad_norm": 0.9483419060707092,
      "learning_rate": 9.929228476350423e-06,
      "loss": 0.296,
      "mae_dtheta": 0.03847004100680351,
      "mae_dx": 0.014740842394530773,
      "mae_dy": 0.010171680711209774,
      "pose_mae_dtheta": 0.25543564558029175,
      "pose_mae_dx": 0.11592864245176315,
      "pose_mae_dy": 0.1082705557346344,
      "pose_rmse_dtheta": 0.41718196868896484,
      "pose_rmse_dx": 0.23920227587223053,
      "pose_rmse_dy": 0.19097843766212463,
      "pose_rmse_mean": 0.2824542224407196,
      "rmse_dtheta": 0.05296443775296211,
      "rmse_dx": 0.02872426062822342,
      "rmse_dy": 0.01721758209168911,
      "rmse_mean": 0.03296876326203346,
      "rotation_flip": 0.013513513840734959,
      "sparse_tokens": 8051.0,
      "step": 758,
      "turn_loss": 0.4040636718273163,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.035262962274670136,
      "grad_norm": 0.5380728244781494,
      "learning_rate": 9.929006627092298e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.011213497258722782,
      "mae_dx": 0.002319063525646925,
      "mae_dy": 0.003038743743672967,
      "pose_mae_dtheta": 0.0732206404209137,
      "pose_mae_dx": 0.03237617015838623,
      "pose_mae_dy": 0.03486102446913719,
      "pose_rmse_dtheta": 0.13815493881702423,
      "pose_rmse_dx": 0.07040385901927948,
      "pose_rmse_dy": 0.07422740757465363,
      "pose_rmse_mean": 0.09426206350326538,
      "rmse_dtheta": 0.020872173830866814,
      "rmse_dx": 0.00606828136369586,
      "rmse_dy": 0.006343183573335409,
      "rmse_mean": 0.011094546876847744,
      "rotation_flip": 0.008280014619231224,
      "sparse_tokens": 32089.0,
      "step": 759,
      "turn_loss": 0.10345356166362762,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10698.0,
      "epoch": 0.03530942204051291,
      "grad_norm": 0.45952701568603516,
      "learning_rate": 9.928784433146097e-06,
      "loss": 0.1094,
      "mae_dtheta": 0.024890678003430367,
      "mae_dx": 0.009652080945670605,
      "mae_dy": 0.003540811827406287,
      "pose_mae_dtheta": 0.2195318192243576,
      "pose_mae_dx": 0.09243029356002808,
      "pose_mae_dy": 0.04849570244550705,
      "pose_rmse_dtheta": 0.42035171389579773,
      "pose_rmse_dx": 0.19566747546195984,
      "pose_rmse_dy": 0.136697456240654,
      "pose_rmse_mean": 0.2509055733680725,
      "rmse_dtheta": 0.044931504875421524,
      "rmse_dx": 0.01987403631210327,
      "rmse_dy": 0.0075128767639398575,
      "rmse_mean": 0.024106137454509735,
      "rotation_flip": 0.013227513059973717,
      "sparse_tokens": 8957.0,
      "step": 760,
      "turn_loss": 0.2229173481464386,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.035355881806355696,
      "grad_norm": 0.6054719686508179,
      "learning_rate": 9.928561894527354e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.015272213146090508,
      "mae_dx": 0.0025639773812144995,
      "mae_dy": 0.004682342056185007,
      "pose_mae_dtheta": 0.11560371518135071,
      "pose_mae_dx": 0.046405863016843796,
      "pose_mae_dy": 0.058851685374975204,
      "pose_rmse_dtheta": 0.2201777845621109,
      "pose_rmse_dx": 0.1125473901629448,
      "pose_rmse_dy": 0.14180387556552887,
      "pose_rmse_mean": 0.15817634761333466,
      "rmse_dtheta": 0.02745218761265278,
      "rmse_dx": 0.006447986233979464,
      "rmse_dy": 0.009848934598267078,
      "rmse_mean": 0.014583036303520203,
      "rotation_flip": 0.009560906328260899,
      "sparse_tokens": 32057.0,
      "step": 761,
      "turn_loss": 0.1160721406340599,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.03540234157219847,
      "grad_norm": 0.4315486550331116,
      "learning_rate": 9.928339011251631e-06,
      "loss": 0.0934,
      "mae_dtheta": 0.016560981050133705,
      "mae_dx": 0.0032593421638011932,
      "mae_dy": 0.0054557835683226585,
      "pose_mae_dtheta": 0.12219267338514328,
      "pose_mae_dx": 0.043938931077718735,
      "pose_mae_dy": 0.05578700453042984,
      "pose_rmse_dtheta": 0.24528716504573822,
      "pose_rmse_dx": 0.09264267235994339,
      "pose_rmse_dy": 0.12254780530929565,
      "pose_rmse_mean": 0.15349255502223969,
      "rmse_dtheta": 0.03106282278895378,
      "rmse_dx": 0.007718245964497328,
      "rmse_dy": 0.011175842024385929,
      "rmse_mean": 0.01665230467915535,
      "rotation_flip": 0.007169682532548904,
      "sparse_tokens": 32073.0,
      "step": 762,
      "turn_loss": 0.1510743349790573,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.03544880133804126,
      "grad_norm": 0.7003613114356995,
      "learning_rate": 9.928115783334518e-06,
      "loss": 0.1716,
      "mae_dtheta": 0.015211382880806923,
      "mae_dx": 0.0025426086504012346,
      "mae_dy": 0.004794453736394644,
      "pose_mae_dtheta": 0.1108388677239418,
      "pose_mae_dx": 0.04006949067115784,
      "pose_mae_dy": 0.06200535595417023,
      "pose_rmse_dtheta": 0.21237799525260925,
      "pose_rmse_dx": 0.09213706851005554,
      "pose_rmse_dy": 0.1342562437057495,
      "pose_rmse_mean": 0.14625710248947144,
      "rmse_dtheta": 0.025781208649277687,
      "rmse_dx": 0.00706594018265605,
      "rmse_dy": 0.01047307625412941,
      "rmse_mean": 0.014440074563026428,
      "rotation_flip": 0.006177076138556004,
      "sparse_tokens": 32057.0,
      "step": 763,
      "turn_loss": 0.1411152333021164,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.035495261103884033,
      "grad_norm": 0.6021425724029541,
      "learning_rate": 9.927892210791621e-06,
      "loss": 0.1518,
      "mae_dtheta": 0.014810817316174507,
      "mae_dx": 0.002459131181240082,
      "mae_dy": 0.0031949831172823906,
      "pose_mae_dtheta": 0.1158730685710907,
      "pose_mae_dx": 0.04089975357055664,
      "pose_mae_dy": 0.0598020926117897,
      "pose_rmse_dtheta": 0.2182181030511856,
      "pose_rmse_dx": 0.10854577273130417,
      "pose_rmse_dy": 0.13032862544059753,
      "pose_rmse_mean": 0.15236416459083557,
      "rmse_dtheta": 0.026308836415410042,
      "rmse_dx": 0.008416383527219296,
      "rmse_dy": 0.005725366063416004,
      "rmse_mean": 0.013483528047800064,
      "rotation_flip": 0.0032428051345050335,
      "sparse_tokens": 32089.0,
      "step": 764,
      "turn_loss": 0.14335420727729797,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.03554172086972682,
      "grad_norm": 0.49345850944519043,
      "learning_rate": 9.927668293638576e-06,
      "loss": 0.121,
      "mae_dtheta": 0.007954652421176434,
      "mae_dx": 0.002563317073509097,
      "mae_dy": 0.001643302384763956,
      "pose_mae_dtheta": 0.05592360720038414,
      "pose_mae_dx": 0.029969733208417892,
      "pose_mae_dy": 0.0266755148768425,
      "pose_rmse_dtheta": 0.14968550205230713,
      "pose_rmse_dx": 0.11766546219587326,
      "pose_rmse_dy": 0.08084577322006226,
      "pose_rmse_mean": 0.11606558412313461,
      "rmse_dtheta": 0.020326467230916023,
      "rmse_dx": 0.01045423187315464,
      "rmse_dy": 0.004088723100721836,
      "rmse_mean": 0.011623140424489975,
      "rotation_flip": 0.0012338062515482306,
      "sparse_tokens": 32041.0,
      "step": 765,
      "turn_loss": 0.0753348171710968,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28140.0,
      "epoch": 0.035588180635569594,
      "grad_norm": 0.7423297166824341,
      "learning_rate": 9.927444031891044e-06,
      "loss": 0.1248,
      "mae_dtheta": 0.02421681396663189,
      "mae_dx": 0.013109403662383556,
      "mae_dy": 0.004478788934648037,
      "pose_mae_dtheta": 0.20355480909347534,
      "pose_mae_dx": 0.11538007855415344,
      "pose_mae_dy": 0.05817198380827904,
      "pose_rmse_dtheta": 0.3996161222457886,
      "pose_rmse_dx": 0.2668053209781647,
      "pose_rmse_dy": 0.1602078378200531,
      "pose_rmse_mean": 0.27554309368133545,
      "rmse_dtheta": 0.04121818393468857,
      "rmse_dx": 0.02716066874563694,
      "rmse_dy": 0.009698580950498581,
      "rmse_mean": 0.026025813072919846,
      "rotation_flip": 0.012484394945204258,
      "sparse_tokens": 12068.0,
      "step": 766,
      "turn_loss": 0.22083957493305206,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.03563464040141238,
      "grad_norm": 0.5965407490730286,
      "learning_rate": 9.927219425564707e-06,
      "loss": 0.1444,
      "mae_dtheta": 0.03408793359994888,
      "mae_dx": 0.01024985034018755,
      "mae_dy": 0.003981052897870541,
      "pose_mae_dtheta": 0.2661805748939514,
      "pose_mae_dx": 0.09055601060390472,
      "pose_mae_dy": 0.0709688737988472,
      "pose_rmse_dtheta": 0.44332218170166016,
      "pose_rmse_dx": 0.21396806836128235,
      "pose_rmse_dy": 0.1647268384695053,
      "pose_rmse_mean": 0.2740057110786438,
      "rmse_dtheta": 0.05098913237452507,
      "rmse_dx": 0.023403214290738106,
      "rmse_dy": 0.007940317504107952,
      "rmse_mean": 0.027444221079349518,
      "rotation_flip": 0.012886597774922848,
      "sparse_tokens": 6592.0,
      "step": 767,
      "turn_loss": 0.23822925984859467,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.035681100167255154,
      "grad_norm": 0.6301507353782654,
      "learning_rate": 9.926994474675272e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.04865226894617081,
      "mae_dx": 0.011255217716097832,
      "mae_dy": 0.005496119149029255,
      "pose_mae_dtheta": 0.41002196073532104,
      "pose_mae_dx": 0.09862188249826431,
      "pose_mae_dy": 0.06917639076709747,
      "pose_rmse_dtheta": 0.6704047322273254,
      "pose_rmse_dx": 0.19332587718963623,
      "pose_rmse_dy": 0.16979163885116577,
      "pose_rmse_mean": 0.3445074260234833,
      "rmse_dtheta": 0.06848062574863434,
      "rmse_dx": 0.02220599167048931,
      "rmse_dy": 0.01146123930811882,
      "rmse_mean": 0.03404928743839264,
      "rotation_flip": 0.013565891422331333,
      "sparse_tokens": 17774.0,
      "step": 768,
      "turn_loss": 0.34715428948402405,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 29108.0,
      "epoch": 0.03572755993309794,
      "grad_norm": 0.7320441603660583,
      "learning_rate": 9.926769179238467e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.03215435519814491,
      "mae_dx": 0.016277777031064034,
      "mae_dy": 0.004248273558914661,
      "pose_mae_dtheta": 0.2792309820652008,
      "pose_mae_dx": 0.15347446501255035,
      "pose_mae_dy": 0.07289258390665054,
      "pose_rmse_dtheta": 0.5094356536865234,
      "pose_rmse_dx": 0.34080711007118225,
      "pose_rmse_dy": 0.1565706580877304,
      "pose_rmse_mean": 0.3356044888496399,
      "rmse_dtheta": 0.05162270739674568,
      "rmse_dx": 0.032307107001543045,
      "rmse_dy": 0.008494642563164234,
      "rmse_mean": 0.030808154493570328,
      "rotation_flip": 0.0077092512510716915,
      "sparse_tokens": 20903.0,
      "step": 769,
      "turn_loss": 0.21712830662727356,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.035774019698940715,
      "grad_norm": 0.6316165328025818,
      "learning_rate": 9.926543539270048e-06,
      "loss": 0.1661,
      "mae_dtheta": 0.012282113544642925,
      "mae_dx": 0.0029080782551318407,
      "mae_dy": 0.003246880369260907,
      "pose_mae_dtheta": 0.08708755671977997,
      "pose_mae_dx": 0.039527393877506256,
      "pose_mae_dy": 0.03470790758728981,
      "pose_rmse_dtheta": 0.21956227719783783,
      "pose_rmse_dx": 0.09712494164705276,
      "pose_rmse_dy": 0.08836621046066284,
      "pose_rmse_mean": 0.13501781225204468,
      "rmse_dtheta": 0.0271193478256464,
      "rmse_dx": 0.007725895382463932,
      "rmse_dy": 0.007432003505527973,
      "rmse_mean": 0.014092415571212769,
      "rotation_flip": 0.005873715039342642,
      "sparse_tokens": 32153.0,
      "step": 770,
      "turn_loss": 0.10182084888219833,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32114.0,
      "epoch": 0.0358204794647835,
      "grad_norm": 0.5959187150001526,
      "learning_rate": 9.926317554785796e-06,
      "loss": 0.169,
      "mae_dtheta": 0.034776490181684494,
      "mae_dx": 0.012784681282937527,
      "mae_dy": 0.007443300448358059,
      "pose_mae_dtheta": 0.2746119201183319,
      "pose_mae_dx": 0.11247016489505768,
      "pose_mae_dy": 0.08048515021800995,
      "pose_rmse_dtheta": 0.4916701912879944,
      "pose_rmse_dx": 0.22885562479496002,
      "pose_rmse_dy": 0.22228553891181946,
      "pose_rmse_mean": 0.3142704665660858,
      "rmse_dtheta": 0.05413138493895531,
      "rmse_dx": 0.023548221215605736,
      "rmse_dy": 0.017112646251916885,
      "rmse_mean": 0.03159741684794426,
      "rotation_flip": 0.008827238343656063,
      "sparse_tokens": 24496.0,
      "step": 771,
      "turn_loss": 0.308465838432312,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.035866939230626275,
      "grad_norm": 0.5615441799163818,
      "learning_rate": 9.926091225801513e-06,
      "loss": 0.1143,
      "mae_dtheta": 0.010035802610218525,
      "mae_dx": 0.002227682853117585,
      "mae_dy": 0.001237139687873423,
      "pose_mae_dtheta": 0.07060112059116364,
      "pose_mae_dx": 0.02221154235303402,
      "pose_mae_dy": 0.019338982179760933,
      "pose_rmse_dtheta": 0.21440990269184113,
      "pose_rmse_dx": 0.0613224133849144,
      "pose_rmse_dy": 0.04582695662975311,
      "pose_rmse_mean": 0.10718642175197601,
      "rmse_dtheta": 0.026323072612285614,
      "rmse_dx": 0.006656578276306391,
      "rmse_dy": 0.002522950293496251,
      "rmse_mean": 0.011834200471639633,
      "rotation_flip": 0.0019203072879463434,
      "sparse_tokens": 32137.0,
      "step": 772,
      "turn_loss": 0.06779900193214417,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.03591339899646906,
      "grad_norm": 0.6155446767807007,
      "learning_rate": 9.925864552333027e-06,
      "loss": 0.1517,
      "mae_dtheta": 0.03471088036894798,
      "mae_dx": 0.011432723142206669,
      "mae_dy": 0.006486713886260986,
      "pose_mae_dtheta": 0.26678645610809326,
      "pose_mae_dx": 0.07957082241773605,
      "pose_mae_dy": 0.06980245560407639,
      "pose_rmse_dtheta": 0.49842512607574463,
      "pose_rmse_dx": 0.18282704055309296,
      "pose_rmse_dy": 0.18358807265758514,
      "pose_rmse_mean": 0.28828009963035583,
      "rmse_dtheta": 0.05411386117339134,
      "rmse_dx": 0.02328837290406227,
      "rmse_dy": 0.013107536360621452,
      "rmse_mean": 0.030169924721121788,
      "rotation_flip": 0.012658228166401386,
      "sparse_tokens": 9916.0,
      "step": 773,
      "turn_loss": 0.2167995572090149,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.035959858762311836,
      "grad_norm": 0.6127124428749084,
      "learning_rate": 9.925637534396188e-06,
      "loss": 0.1216,
      "mae_dtheta": 0.015133203007280827,
      "mae_dx": 0.00273221917450428,
      "mae_dy": 0.002787543460726738,
      "pose_mae_dtheta": 0.11238481849431992,
      "pose_mae_dx": 0.03667239099740982,
      "pose_mae_dy": 0.04844976216554642,
      "pose_rmse_dtheta": 0.22797627747058868,
      "pose_rmse_dx": 0.09444578737020493,
      "pose_rmse_dy": 0.11729428172111511,
      "pose_rmse_mean": 0.14657211303710938,
      "rmse_dtheta": 0.027921538800001144,
      "rmse_dx": 0.00843338668346405,
      "rmse_dy": 0.005638536065816879,
      "rmse_mean": 0.013997821137309074,
      "rotation_flip": 0.0030222893692553043,
      "sparse_tokens": 32105.0,
      "step": 774,
      "turn_loss": 0.12357053905725479,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.03600631852815462,
      "grad_norm": 0.6517024636268616,
      "learning_rate": 9.925410172006874e-06,
      "loss": 0.1344,
      "mae_dtheta": 0.039202556014060974,
      "mae_dx": 0.017588645219802856,
      "mae_dy": 0.00594436377286911,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.651702344417572,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 114.85201263427734,
      "model/head/act_norm_mean": 92.15767728365384,
      "model/head/act_norm_min": 70.49079895019531,
      "model/head/act_over_embed": 63.33161862309519,
      "model/head/grad_frac": 0.09198091179132462,
      "model/head/grad_norm": 0.05994417518377304,
      "model/head/grad_zero_frac": 0.000138965027872473,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6780348557692307,
      "model/head/update_ratio": 0.0010470125125721097,
      "model/head/weight_delta": 3.0926716327667236,
      "model/head/weight_delta_rel": 0.054254621267318726,
      "model/head/weight_norm": 57.25259017944336,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4108309745788574,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4108309745788574,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4108309745788574,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28232689199077365,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08157426118850708,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05316213518381119,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.541015625,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017334971344098449,
      "model/modality_embedder.encoders.pose/weight_delta": 0.9405763745307922,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.03073156252503395,
      "model/modality_embedder.encoders.pose/weight_norm": 30.667564392089844,
      "model/modality_embedder/grad_frac": 0.08157426118850708,
      "model/modality_embedder/grad_norm": 0.05316213518381119,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.541015625,
      "model/modality_embedder/update_ratio": 0.0017334971344098449,
      "model/modality_embedder/weight_delta": 0.9405763745307922,
      "model/modality_embedder/weight_delta_rel": 0.03073156252503395,
      "model/modality_embedder/weight_norm": 30.667564392089844,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 56.977317810058594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.54327400030525,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.047514915466309,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.804739584318657,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07251299172639847,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04725688695907593,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001718468265607953,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.4596627652645111,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.016750387847423553,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.49942398071289,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 58.47882080078125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.43801510989011,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.61429214477539,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.419614051523617,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07155857235193253,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.046634890139102936,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016093207523226738,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.54830402135849,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.01899367943406105,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.977994918823242,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 60.15786361694336,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.102669032356534,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.77876091003418,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.56357981177811,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06956976652145386,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04533877968788147,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015164031647145748,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.5670780539512634,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.01904141902923584,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.898895263671875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 60.705257415771484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.11194816468254,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.942853927612305,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 17.944375242680152,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07559847831726074,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04926770552992821,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016788109205663204,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.4789009988307953,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.016366563737392426,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.346786499023438,
      "model/normalizer/grad_frac": 0.3124646544456482,
      "model/normalizer/grad_norm": 0.20363394916057587,
      "model/normalizer/grad_zero_frac": 0.00018316945352125913,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00261852890253067,
      "model/normalizer/weight_delta": 1.058436393737793,
      "model/normalizer/weight_delta_rel": 0.013632047921419144,
      "model/normalizer/weight_norm": 77.76654815673828,
      "pose_mae_dtheta": 0.34256795048713684,
      "pose_mae_dx": 0.1465793251991272,
      "pose_mae_dy": 0.07554242759943008,
      "pose_rmse_dtheta": 0.5735195875167847,
      "pose_rmse_dx": 0.3094358742237091,
      "pose_rmse_dy": 0.16320505738258362,
      "pose_rmse_mean": 0.34872016310691833,
      "rmse_dtheta": 0.05753317102789879,
      "rmse_dx": 0.03100990317761898,
      "rmse_dy": 0.011045501567423344,
      "rmse_mean": 0.03319619223475456,
      "rotation_flip": 0.010610079392790794,
      "sparse_tokens": 6328.0,
      "step": 775,
      "turn_loss": 0.32514768838882446,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.036052778293997396,
      "grad_norm": 0.5534979701042175,
      "learning_rate": 9.925182465180983e-06,
      "loss": 0.0854,
      "mae_dtheta": 0.00913368258625269,
      "mae_dx": 0.001475233817473054,
      "mae_dy": 0.0012206729734316468,
      "pose_mae_dtheta": 0.0690874233841896,
      "pose_mae_dx": 0.017407746985554695,
      "pose_mae_dy": 0.020013296976685524,
      "pose_rmse_dtheta": 0.21814927458763123,
      "pose_rmse_dx": 0.04731747508049011,
      "pose_rmse_dy": 0.05147091671824455,
      "pose_rmse_mean": 0.10564588755369186,
      "rmse_dtheta": 0.024724269285798073,
      "rmse_dx": 0.005166403483599424,
      "rmse_dy": 0.002397401724010706,
      "rmse_mean": 0.010762691497802734,
      "rotation_flip": 0.0009372071363031864,
      "sparse_tokens": 32105.0,
      "step": 776,
      "turn_loss": 0.05850373953580856,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.03609923805984018,
      "grad_norm": 0.5294371843338013,
      "learning_rate": 9.924954413934437e-06,
      "loss": 0.1451,
      "mae_dtheta": 0.010363247245550156,
      "mae_dx": 0.0020702406764030457,
      "mae_dy": 0.002009493065997958,
      "pose_mae_dtheta": 0.07066895067691803,
      "pose_mae_dx": 0.024304136633872986,
      "pose_mae_dy": 0.030346620827913284,
      "pose_rmse_dtheta": 0.14309994876384735,
      "pose_rmse_dx": 0.05387816205620766,
      "pose_rmse_dy": 0.06600753962993622,
      "pose_rmse_mean": 0.08766188472509384,
      "rmse_dtheta": 0.020069347694516182,
      "rmse_dx": 0.005926288664340973,
      "rmse_dy": 0.004045231733471155,
      "rmse_mean": 0.010013623163104057,
      "rotation_flip": 0.0022505626548081636,
      "sparse_tokens": 32121.0,
      "step": 777,
      "turn_loss": 0.07258135080337524,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.03614569782568296,
      "grad_norm": 0.7050281167030334,
      "learning_rate": 9.924726018283187e-06,
      "loss": 0.1148,
      "mae_dtheta": 0.012418334372341633,
      "mae_dx": 0.002103072125464678,
      "mae_dy": 0.002692566020414233,
      "pose_mae_dtheta": 0.08802183717489243,
      "pose_mae_dx": 0.029423406347632408,
      "pose_mae_dy": 0.03028206154704094,
      "pose_rmse_dtheta": 0.24097585678100586,
      "pose_rmse_dx": 0.07764365524053574,
      "pose_rmse_dy": 0.07789237797260284,
      "pose_rmse_mean": 0.1321706473827362,
      "rmse_dtheta": 0.028899921104311943,
      "rmse_dx": 0.006147931329905987,
      "rmse_dy": 0.006308482959866524,
      "rmse_mean": 0.01378544420003891,
      "rotation_flip": 0.003950834274291992,
      "sparse_tokens": 32089.0,
      "step": 778,
      "turn_loss": 0.0897529199719429,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.03619215759152574,
      "grad_norm": 0.4067096412181854,
      "learning_rate": 9.924497278243204e-06,
      "loss": 0.1206,
      "mae_dtheta": 0.0097306277602911,
      "mae_dx": 0.002144602593034506,
      "mae_dy": 0.002140338532626629,
      "pose_mae_dtheta": 0.06843872368335724,
      "pose_mae_dx": 0.023821312934160233,
      "pose_mae_dy": 0.023680761456489563,
      "pose_rmse_dtheta": 0.1669197976589203,
      "pose_rmse_dx": 0.0671585276722908,
      "pose_rmse_dy": 0.06013260409235954,
      "pose_rmse_mean": 0.09807030856609344,
      "rmse_dtheta": 0.020826876163482666,
      "rmse_dx": 0.006243002600967884,
      "rmse_dy": 0.004865719471126795,
      "rmse_mean": 0.010645199567079544,
      "rotation_flip": 0.005571030545979738,
      "sparse_tokens": 32121.0,
      "step": 779,
      "turn_loss": 0.09606092423200607,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.03623861735736852,
      "grad_norm": 0.36835235357284546,
      "learning_rate": 9.924268193830481e-06,
      "loss": 0.0867,
      "mae_dtheta": 0.03281588479876518,
      "mae_dx": 0.015617826953530312,
      "mae_dy": 0.005544265732169151,
      "pose_mae_dtheta": 0.3027377128601074,
      "pose_mae_dx": 0.13417069613933563,
      "pose_mae_dy": 0.0724266842007637,
      "pose_rmse_dtheta": 0.4891952574253082,
      "pose_rmse_dx": 0.2753014862537384,
      "pose_rmse_dy": 0.14467743039131165,
      "pose_rmse_mean": 0.30305808782577515,
      "rmse_dtheta": 0.04827683046460152,
      "rmse_dx": 0.02852610871195793,
      "rmse_dy": 0.009788235649466515,
      "rmse_mean": 0.028863726183772087,
      "rotation_flip": 0.02088772878050804,
      "sparse_tokens": 6418.0,
      "step": 780,
      "turn_loss": 0.23185712099075317,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.0362850771232113,
      "grad_norm": 0.5315782427787781,
      "learning_rate": 9.924038765061042e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.011779137887060642,
      "mae_dx": 0.002484417986124754,
      "mae_dy": 0.0023683991748839617,
      "pose_mae_dtheta": 0.08230972290039062,
      "pose_mae_dx": 0.023213909938931465,
      "pose_mae_dy": 0.027284692972898483,
      "pose_rmse_dtheta": 0.2193460315465927,
      "pose_rmse_dx": 0.058125391602516174,
      "pose_rmse_dy": 0.06343062967061996,
      "pose_rmse_mean": 0.11363402009010315,
      "rmse_dtheta": 0.026559310033917427,
      "rmse_dx": 0.007724291179329157,
      "rmse_dy": 0.006164856255054474,
      "rmse_mean": 0.013482819311320782,
      "rotation_flip": 0.006793478038161993,
      "sparse_tokens": 32105.0,
      "step": 781,
      "turn_loss": 0.09656635671854019,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.03633153688905408,
      "grad_norm": 0.7953230738639832,
      "learning_rate": 9.923808991950926e-06,
      "loss": 0.1464,
      "mae_dtheta": 0.017772866412997246,
      "mae_dx": 0.005750587210059166,
      "mae_dy": 0.0061668409034609795,
      "pose_mae_dtheta": 0.13264456391334534,
      "pose_mae_dx": 0.07248314470052719,
      "pose_mae_dy": 0.054378215223550797,
      "pose_rmse_dtheta": 0.27338579297065735,
      "pose_rmse_dx": 0.1924203336238861,
      "pose_rmse_dy": 0.11206308007240295,
      "pose_rmse_mean": 0.1926230639219284,
      "rmse_dtheta": 0.03191462159156799,
      "rmse_dx": 0.01484778430312872,
      "rmse_dy": 0.012441751547157764,
      "rmse_mean": 0.019734719768166542,
      "rotation_flip": 0.006986344698816538,
      "sparse_tokens": 32105.0,
      "step": 782,
      "turn_loss": 0.17765480279922485,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.03637799665489686,
      "grad_norm": 0.6459372043609619,
      "learning_rate": 9.92357887451621e-06,
      "loss": 0.1896,
      "mae_dtheta": 0.04412643983960152,
      "mae_dx": 0.015429033897817135,
      "mae_dy": 0.0062994081526994705,
      "pose_mae_dtheta": 0.3664338290691376,
      "pose_mae_dx": 0.14281582832336426,
      "pose_mae_dy": 0.08406118303537369,
      "pose_rmse_dtheta": 0.6092967987060547,
      "pose_rmse_dx": 0.28634944558143616,
      "pose_rmse_dy": 0.2160193920135498,
      "pose_rmse_mean": 0.37055522203445435,
      "rmse_dtheta": 0.06139088794589043,
      "rmse_dx": 0.02953069657087326,
      "rmse_dy": 0.012162732891738415,
      "rmse_mean": 0.03436143696308136,
      "rotation_flip": 0.009815950877964497,
      "sparse_tokens": 14392.0,
      "step": 783,
      "turn_loss": 0.35516542196273804,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 41864.0,
      "epoch": 0.03642445642073964,
      "grad_norm": 0.510397732257843,
      "learning_rate": 9.923348412772975e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.028023112565279007,
      "mae_dx": 0.01106203906238079,
      "mae_dy": 0.004704076796770096,
      "pose_mae_dtheta": 0.21279975771903992,
      "pose_mae_dx": 0.08916264027357101,
      "pose_mae_dy": 0.052192848175764084,
      "pose_rmse_dtheta": 0.3850741684436798,
      "pose_rmse_dx": 0.21218319237232208,
      "pose_rmse_dy": 0.11917843669652939,
      "pose_rmse_mean": 0.2388119399547577,
      "rmse_dtheta": 0.043832939118146896,
      "rmse_dx": 0.023587137460708618,
      "rmse_dy": 0.009298790246248245,
      "rmse_mean": 0.02557295560836792,
      "rotation_flip": 0.01043296791613102,
      "sparse_tokens": 30164.0,
      "step": 784,
      "turn_loss": 0.22212162613868713,
      "turns": 129.0,
      "turns_per_sample": 129.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.03647091618658242,
      "grad_norm": 0.5031023025512695,
      "learning_rate": 9.923117606737347e-06,
      "loss": 0.1383,
      "mae_dtheta": 0.009604978375136852,
      "mae_dx": 0.00244255643337965,
      "mae_dy": 0.0020578475669026375,
      "pose_mae_dtheta": 0.0689987763762474,
      "pose_mae_dx": 0.025348376482725143,
      "pose_mae_dy": 0.022562094032764435,
      "pose_rmse_dtheta": 0.1631690114736557,
      "pose_rmse_dx": 0.06231814995408058,
      "pose_rmse_dy": 0.051361262798309326,
      "pose_rmse_mean": 0.09228281676769257,
      "rmse_dtheta": 0.0198715440928936,
      "rmse_dx": 0.007303436286747456,
      "rmse_dy": 0.004513229243457317,
      "rmse_mean": 0.010562736541032791,
      "rotation_flip": 0.002754820976406336,
      "sparse_tokens": 32153.0,
      "step": 785,
      "turn_loss": 0.08014827966690063,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0365173759524252,
      "grad_norm": 0.5295495390892029,
      "learning_rate": 9.92288645642546e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.01066703163087368,
      "mae_dx": 0.0025623105466365814,
      "mae_dy": 0.0026402410585433245,
      "pose_mae_dtheta": 0.08077903836965561,
      "pose_mae_dx": 0.02875278890132904,
      "pose_mae_dy": 0.03174205869436264,
      "pose_rmse_dtheta": 0.21108266711235046,
      "pose_rmse_dx": 0.08767721801996231,
      "pose_rmse_dy": 0.09289594739675522,
      "pose_rmse_mean": 0.13055194914340973,
      "rmse_dtheta": 0.02437492273747921,
      "rmse_dx": 0.007543020881712437,
      "rmse_dy": 0.007534140720963478,
      "rmse_mean": 0.013150694780051708,
      "rotation_flip": 0.006462035700678825,
      "sparse_tokens": 32089.0,
      "step": 786,
      "turn_loss": 0.09960848838090897,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.03656383571826798,
      "grad_norm": 0.46013686060905457,
      "learning_rate": 9.922654961853483e-06,
      "loss": 0.1636,
      "mae_dtheta": 0.036181773990392685,
      "mae_dx": 0.014071556739509106,
      "mae_dy": 0.00835256464779377,
      "pose_mae_dtheta": 0.2839454412460327,
      "pose_mae_dx": 0.11467410624027252,
      "pose_mae_dy": 0.09320130944252014,
      "pose_rmse_dtheta": 0.45923396944999695,
      "pose_rmse_dx": 0.2431757003068924,
      "pose_rmse_dy": 0.2183566838502884,
      "pose_rmse_mean": 0.30692213773727417,
      "rmse_dtheta": 0.05440127104520798,
      "rmse_dx": 0.026964522898197174,
      "rmse_dy": 0.017742395401000977,
      "rmse_mean": 0.033036064356565475,
      "rotation_flip": 0.01617507077753544,
      "sparse_tokens": 16947.0,
      "step": 787,
      "turn_loss": 0.3595379590988159,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.03661029548411076,
      "grad_norm": 0.5614748001098633,
      "learning_rate": 9.9224231230376e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.024802202358841896,
      "mae_dx": 0.010116612538695335,
      "mae_dy": 0.003072410821914673,
      "pose_mae_dtheta": 0.1678764969110489,
      "pose_mae_dx": 0.06658190488815308,
      "pose_mae_dy": 0.050153542309999466,
      "pose_rmse_dtheta": 0.339130699634552,
      "pose_rmse_dx": 0.18088461458683014,
      "pose_rmse_dy": 0.12714511156082153,
      "pose_rmse_mean": 0.21572014689445496,
      "rmse_dtheta": 0.04198760166764259,
      "rmse_dx": 0.0238188523799181,
      "rmse_dy": 0.0065887849777936935,
      "rmse_mean": 0.02413174882531166,
      "rotation_flip": 0.009247027337551117,
      "sparse_tokens": 14260.0,
      "step": 788,
      "turn_loss": 0.21170909702777863,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.03665675524995354,
      "grad_norm": 0.5979836583137512,
      "learning_rate": 9.922190939994028e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.00919360388070345,
      "mae_dx": 0.0030303767416626215,
      "mae_dy": 0.0007585592684336007,
      "pose_mae_dtheta": 0.07218535989522934,
      "pose_mae_dx": 0.025015814229846,
      "pose_mae_dy": 0.012245017103850842,
      "pose_rmse_dtheta": 0.26911330223083496,
      "pose_rmse_dx": 0.08988834172487259,
      "pose_rmse_dy": 0.032846298068761826,
      "pose_rmse_mean": 0.1306159794330597,
      "rmse_dtheta": 0.02901092730462551,
      "rmse_dx": 0.009780114516615868,
      "rmse_dy": 0.0019576591439545155,
      "rmse_mean": 0.013582900166511536,
      "rotation_flip": 0.0034149116836488247,
      "sparse_tokens": 32185.0,
      "step": 789,
      "turn_loss": 0.08500976115465164,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.03670321501579632,
      "grad_norm": 0.44332486391067505,
      "learning_rate": 9.921958412738999e-06,
      "loss": 0.1085,
      "mae_dtheta": 0.012683077715337276,
      "mae_dx": 0.002736590104177594,
      "mae_dy": 0.0027028508484363556,
      "pose_mae_dtheta": 0.0961591824889183,
      "pose_mae_dx": 0.030483637005090714,
      "pose_mae_dy": 0.028898797929286957,
      "pose_rmse_dtheta": 0.2347794771194458,
      "pose_rmse_dx": 0.07686527818441391,
      "pose_rmse_dy": 0.06589584052562714,
      "pose_rmse_mean": 0.12584686279296875,
      "rmse_dtheta": 0.026326296851038933,
      "rmse_dx": 0.007949091494083405,
      "rmse_dy": 0.006523016840219498,
      "rmse_mean": 0.01359946932643652,
      "rotation_flip": 0.002201834926381707,
      "sparse_tokens": 32121.0,
      "step": 790,
      "turn_loss": 0.11280687898397446,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.036749674781639104,
      "grad_norm": 0.7472760677337646,
      "learning_rate": 9.921725541288779e-06,
      "loss": 0.214,
      "mae_dtheta": 0.016462717205286026,
      "mae_dx": 0.003236123826354742,
      "mae_dy": 0.003771185176447034,
      "pose_mae_dtheta": 0.12131855636835098,
      "pose_mae_dx": 0.038354307413101196,
      "pose_mae_dy": 0.036270540207624435,
      "pose_rmse_dtheta": 0.28046324849128723,
      "pose_rmse_dx": 0.09000393003225327,
      "pose_rmse_dy": 0.09223435074090958,
      "pose_rmse_mean": 0.15423384308815002,
      "rmse_dtheta": 0.03272414952516556,
      "rmse_dx": 0.007999076507985592,
      "rmse_dy": 0.00826902873814106,
      "rmse_mean": 0.01633075252175331,
      "rotation_flip": 0.009171076118946075,
      "sparse_tokens": 32169.0,
      "step": 791,
      "turn_loss": 0.1480904072523117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.03679613454748188,
      "grad_norm": 1.3898202180862427,
      "learning_rate": 9.92149232565965e-06,
      "loss": 0.2053,
      "mae_dtheta": 0.03702681511640549,
      "mae_dx": 0.013738070614635944,
      "mae_dy": 0.008072325959801674,
      "pose_mae_dtheta": 0.29552918672561646,
      "pose_mae_dx": 0.10603588819503784,
      "pose_mae_dy": 0.09929009526968002,
      "pose_rmse_dtheta": 0.4769655168056488,
      "pose_rmse_dx": 0.22796279191970825,
      "pose_rmse_dy": 0.19848476350307465,
      "pose_rmse_mean": 0.30113768577575684,
      "rmse_dtheta": 0.05080966278910637,
      "rmse_dx": 0.027162667363882065,
      "rmse_dy": 0.014561524614691734,
      "rmse_mean": 0.030844619497656822,
      "rotation_flip": 0.014306151308119297,
      "sparse_tokens": 11645.0,
      "step": 792,
      "turn_loss": 0.3641528785228729,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.036842594313324664,
      "grad_norm": 0.630859375,
      "learning_rate": 9.921258765867919e-06,
      "loss": 0.1501,
      "mae_dtheta": 0.013580880127847195,
      "mae_dx": 0.003196561010554433,
      "mae_dy": 0.0025019152089953423,
      "pose_mae_dtheta": 0.09521820396184921,
      "pose_mae_dx": 0.033835556358098984,
      "pose_mae_dy": 0.03605129197239876,
      "pose_rmse_dtheta": 0.23075614869594574,
      "pose_rmse_dx": 0.08467580378055573,
      "pose_rmse_dy": 0.09526044130325317,
      "pose_rmse_mean": 0.136897474527359,
      "rmse_dtheta": 0.02811434678733349,
      "rmse_dx": 0.00899237859994173,
      "rmse_dy": 0.005628600250929594,
      "rmse_mean": 0.014245109632611275,
      "rotation_flip": 0.004264392424374819,
      "sparse_tokens": 32121.0,
      "step": 793,
      "turn_loss": 0.11577395349740982,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.03688905407916744,
      "grad_norm": 0.6504865884780884,
      "learning_rate": 9.921024861929922e-06,
      "loss": 0.1494,
      "mae_dtheta": 0.03951433300971985,
      "mae_dx": 0.010284929536283016,
      "mae_dy": 0.012025938369333744,
      "pose_mae_dtheta": 0.30748653411865234,
      "pose_mae_dx": 0.08285897225141525,
      "pose_mae_dy": 0.11718403548002243,
      "pose_rmse_dtheta": 0.5141757130622864,
      "pose_rmse_dx": 0.185096874833107,
      "pose_rmse_dy": 0.2552222013473511,
      "pose_rmse_mean": 0.3181649446487427,
      "rmse_dtheta": 0.05861235037446022,
      "rmse_dx": 0.020100703462958336,
      "rmse_dy": 0.023704005405306816,
      "rmse_mean": 0.03413902223110199,
      "rotation_flip": 0.018803419545292854,
      "sparse_tokens": 10209.0,
      "step": 794,
      "turn_loss": 0.34301871061325073,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.03693551384501022,
      "grad_norm": 0.5546445250511169,
      "learning_rate": 9.920790613862017e-06,
      "loss": 0.1525,
      "mae_dtheta": 0.012316478416323662,
      "mae_dx": 0.0015441153664141893,
      "mae_dy": 0.0029318174347281456,
      "pose_mae_dtheta": 0.08123704046010971,
      "pose_mae_dx": 0.02620524913072586,
      "pose_mae_dy": 0.03857089579105377,
      "pose_rmse_dtheta": 0.17878417670726776,
      "pose_rmse_dx": 0.0625728890299797,
      "pose_rmse_dy": 0.08818535506725311,
      "pose_rmse_mean": 0.10984747111797333,
      "rmse_dtheta": 0.023949075490236282,
      "rmse_dx": 0.004384067840874195,
      "rmse_dy": 0.005854836665093899,
      "rmse_mean": 0.011395993642508984,
      "rotation_flip": 0.0018096271669492126,
      "sparse_tokens": 32089.0,
      "step": 795,
      "turn_loss": 0.09435906261205673,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.036981973610853,
      "grad_norm": 0.7015060186386108,
      "learning_rate": 9.92055602168058e-06,
      "loss": 0.1447,
      "mae_dtheta": 0.04865720123052597,
      "mae_dx": 0.014235392212867737,
      "mae_dy": 0.0031193180475383997,
      "pose_mae_dtheta": 0.39541348814964294,
      "pose_mae_dx": 0.11694568395614624,
      "pose_mae_dy": 0.04892125725746155,
      "pose_rmse_dtheta": 0.5915414094924927,
      "pose_rmse_dx": 0.28838911652565,
      "pose_rmse_dy": 0.12933070957660675,
      "pose_rmse_mean": 0.3364204168319702,
      "rmse_dtheta": 0.06799883395433426,
      "rmse_dx": 0.02971597947180271,
      "rmse_dy": 0.006479873787611723,
      "rmse_mean": 0.03473156318068504,
      "rotation_flip": 0.006756756920367479,
      "sparse_tokens": 2349.0,
      "step": 796,
      "turn_loss": 0.27465587854385376,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.03702843337669578,
      "grad_norm": 0.5046138167381287,
      "learning_rate": 9.920321085402022e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.014232940040528774,
      "mae_dx": 0.002698841504752636,
      "mae_dy": 0.004156764131039381,
      "pose_mae_dtheta": 0.10297247022390366,
      "pose_mae_dx": 0.039245735853910446,
      "pose_mae_dy": 0.0421375147998333,
      "pose_rmse_dtheta": 0.2437828928232193,
      "pose_rmse_dx": 0.0915604680776596,
      "pose_rmse_dy": 0.09120366722345352,
      "pose_rmse_mean": 0.1421823501586914,
      "rmse_dtheta": 0.028593488037586212,
      "rmse_dx": 0.006615653168410063,
      "rmse_dy": 0.00909716822206974,
      "rmse_mean": 0.014768769964575768,
      "rotation_flip": 0.0021598271559923887,
      "sparse_tokens": 32121.0,
      "step": 797,
      "turn_loss": 0.11273116618394852,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.03707489314253856,
      "grad_norm": 0.5964480638504028,
      "learning_rate": 9.92008580504277e-06,
      "loss": 0.1728,
      "mae_dtheta": 0.032310303300619125,
      "mae_dx": 0.009683199226856232,
      "mae_dy": 0.006447899155318737,
      "pose_mae_dtheta": 0.24014270305633545,
      "pose_mae_dx": 0.09052909165620804,
      "pose_mae_dy": 0.07804318517446518,
      "pose_rmse_dtheta": 0.4003278315067291,
      "pose_rmse_dx": 0.18507829308509827,
      "pose_rmse_dy": 0.16571033000946045,
      "pose_rmse_mean": 0.25037217140197754,
      "rmse_dtheta": 0.04814443364739418,
      "rmse_dx": 0.020333655178546906,
      "rmse_dy": 0.0117339501157403,
      "rmse_mean": 0.02673734724521637,
      "rotation_flip": 0.03132530301809311,
      "sparse_tokens": 16099.0,
      "step": 798,
      "turn_loss": 0.2827732264995575,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 14575.0,
      "epoch": 0.03712135290838134,
      "grad_norm": 0.6144941449165344,
      "learning_rate": 9.919850180619274e-06,
      "loss": 0.1444,
      "mae_dtheta": 0.033045072108507156,
      "mae_dx": 0.013498235493898392,
      "mae_dy": 0.005945794750005007,
      "pose_mae_dtheta": 0.2478543221950531,
      "pose_mae_dx": 0.10269168764352798,
      "pose_mae_dy": 0.07268120348453522,
      "pose_rmse_dtheta": 0.40291517972946167,
      "pose_rmse_dx": 0.2154778689146042,
      "pose_rmse_dy": 0.1777612268924713,
      "pose_rmse_mean": 0.2653847634792328,
      "rmse_dtheta": 0.04880765080451965,
      "rmse_dx": 0.025250086560845375,
      "rmse_dy": 0.012248416431248188,
      "rmse_mean": 0.028768718242645264,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 12311.0,
      "step": 799,
      "turn_loss": 0.3052992820739746,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.03716781267422412,
      "grad_norm": 0.4846717417240143,
      "learning_rate": 9.919614212148017e-06,
      "loss": 0.1073,
      "mae_dtheta": 0.008000806905329227,
      "mae_dx": 0.001531569054350257,
      "mae_dy": 0.0017494343919679523,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4846717119216919,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 145.82196044921875,
      "model/head/act_norm_mean": 112.95939867424242,
      "model/head/act_norm_min": 81.9752197265625,
      "model/head/act_over_embed": 77.62675631149163,
      "model/head/grad_frac": 0.11285467445850372,
      "model/head/grad_norm": 0.054697468876838684,
      "model/head/grad_zero_frac": 0.00015006955072749406,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6836677320075758,
      "model/head/update_ratio": 0.0009552413830533624,
      "model/head/weight_delta": 3.137625217437744,
      "model/head/weight_delta_rel": 0.055043239146471024,
      "model/head/weight_norm": 57.2603645324707,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41114065051078796,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41106352655056916,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4109798073768616,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2824867038829198,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0724848210811615,
      "model/modality_embedder.encoders.pose/grad_norm": 0.035131342709064484,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5328672935520362,
      "model/modality_embedder.encoders.pose/update_ratio": 0.00114547205157578,
      "model/modality_embedder.encoders.pose/weight_delta": 0.9398505687713623,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.030707847326993942,
      "model/modality_embedder.encoders.pose/weight_norm": 30.669750213623047,
      "model/modality_embedder/grad_frac": 0.0724848210811615,
      "model/modality_embedder/grad_norm": 0.035131342709064484,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5328672935520362,
      "model/modality_embedder/update_ratio": 0.00114547205157578,
      "model/modality_embedder/weight_delta": 0.9398505687713623,
      "model/modality_embedder/weight_delta_rel": 0.030707847326993942,
      "model/modality_embedder/weight_norm": 30.669750213623047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.83129119873047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.615480198813533,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.994559288024902,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.228779084233636,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07922473549842834,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03839798644185066,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013962313532829285,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.4697645902633667,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.017118504270911217,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.501163482666016,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.77812957763672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.7902712642296,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.21752643585205,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.036106502954798,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07733336091041565,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.037481293082237244,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012932898243889213,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.5614163875579834,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.019447902217507362,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.981355667114258,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.99707794189453,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.803553892095557,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.203742980957031,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.41965317347321,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08281389623880386,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.040137551724910736,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013422598131000996,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.5823598504066467,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.01955455355346203,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.90296745300293,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.78250885009766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.68638518117685,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.181177139282227,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.713552462674127,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10774533450603485,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05222111567854881,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017793497536331415,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.49142923951148987,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.01679471880197525,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.348426818847656,
      "model/normalizer/grad_frac": 0.35503000020980835,
      "model/normalizer/grad_norm": 0.17207299172878265,
      "model/normalizer/grad_zero_frac": 0.00017017032951116562,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002212588908150792,
      "model/normalizer/weight_delta": 1.084774136543274,
      "model/normalizer/weight_delta_rel": 0.013971262611448765,
      "model/normalizer/weight_norm": 77.76998138427734,
      "pose_mae_dtheta": 0.05513234809041023,
      "pose_mae_dx": 0.021110545843839645,
      "pose_mae_dy": 0.02452537976205349,
      "pose_rmse_dtheta": 0.1197674423456192,
      "pose_rmse_dx": 0.052817635238170624,
      "pose_rmse_dy": 0.06460849940776825,
      "pose_rmse_mean": 0.07906452566385269,
      "rmse_dtheta": 0.01685057021677494,
      "rmse_dx": 0.004353483207523823,
      "rmse_dy": 0.0040041436441242695,
      "rmse_mean": 0.008402733132243156,
      "rotation_flip": 0.0013556258054450154,
      "sparse_tokens": 32089.0,
      "step": 800,
      "turn_loss": 0.07444826513528824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.03716781267422412,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.32885196805000305,
      "eval_objectnav_nopose_mae_dtheta": 0.04204424470663071,
      "eval_objectnav_nopose_mae_dx": 0.014257024973630905,
      "eval_objectnav_nopose_mae_dy": 0.0050840554758906364,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3465242087841034,
      "eval_objectnav_nopose_pose_mae_dx": 0.11636460572481155,
      "eval_objectnav_nopose_pose_mae_dy": 0.05896945670247078,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5670830011367798,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24626795947551727,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13357238471508026,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3156411349773407,
      "eval_objectnav_nopose_rmse_dtheta": 0.05918125435709953,
      "eval_objectnav_nopose_rmse_dx": 0.026989616453647614,
      "eval_objectnav_nopose_rmse_dy": 0.01000379677861929,
      "eval_objectnav_nopose_rmse_mean": 0.0320582240819931,
      "eval_objectnav_nopose_rotation_flip": 0.014878449030220509,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.32885196805000305,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 800
    },
    {
      "epoch": 0.03716781267422412,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2943350672721863,
      "eval_objectnav_pose_mae_dtheta": 0.036929115653038025,
      "eval_objectnav_pose_mae_dx": 0.011962413787841797,
      "eval_objectnav_pose_mae_dy": 0.004935659468173981,
      "eval_objectnav_pose_pose_mae_dtheta": 0.287404328584671,
      "eval_objectnav_pose_pose_mae_dx": 0.09542692452669144,
      "eval_objectnav_pose_pose_mae_dy": 0.05285343527793884,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4942251145839691,
      "eval_objectnav_pose_pose_rmse_dx": 0.21638920903205872,
      "eval_objectnav_pose_pose_rmse_dy": 0.12383905053138733,
      "eval_objectnav_pose_pose_rmse_mean": 0.27815112471580505,
      "eval_objectnav_pose_rmse_dtheta": 0.05447937920689583,
      "eval_objectnav_pose_rmse_dx": 0.02425338514149189,
      "eval_objectnav_pose_rmse_dy": 0.010127543471753597,
      "eval_objectnav_pose_rmse_mean": 0.029620103538036346,
      "eval_objectnav_pose_rotation_flip": 0.015397978946566582,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2943350672721863,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 800
    },
    {
      "epoch": 0.03716781267422412,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10894563794136047,
      "eval_pointnav_mae_dtheta": 0.012174082919955254,
      "eval_pointnav_mae_dx": 0.0029986235313117504,
      "eval_pointnav_mae_dy": 0.0028157017659395933,
      "eval_pointnav_pose_mae_dtheta": 0.08833657950162888,
      "eval_pointnav_pose_mae_dx": 0.034005653113126755,
      "eval_pointnav_pose_mae_dy": 0.03248298168182373,
      "eval_pointnav_pose_rmse_dtheta": 0.23209908604621887,
      "eval_pointnav_pose_rmse_dx": 0.09231636673212051,
      "eval_pointnav_pose_rmse_dy": 0.09623490273952484,
      "eval_pointnav_pose_rmse_mean": 0.14021679759025574,
      "eval_pointnav_rmse_dtheta": 0.027895651757717133,
      "eval_pointnav_rmse_dx": 0.008730779401957989,
      "eval_pointnav_rmse_dy": 0.007198745850473642,
      "eval_pointnav_rmse_mean": 0.014608393423259258,
      "eval_pointnav_rotation_flip": 0.005289006512612104,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10894563794136047,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 800
    },
    {
      "epoch": 0.03716781267422412,
      "eval_loss": 0.24404422442118326,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.32885196805000305,
      "eval_objectnav_nopose_mae_dtheta": 0.04204424470663071,
      "eval_objectnav_nopose_mae_dx": 0.014257024973630905,
      "eval_objectnav_nopose_mae_dy": 0.0050840554758906364,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3465242087841034,
      "eval_objectnav_nopose_pose_mae_dx": 0.11636460572481155,
      "eval_objectnav_nopose_pose_mae_dy": 0.05896945670247078,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5670830011367798,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24626795947551727,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13357238471508026,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3156411349773407,
      "eval_objectnav_nopose_rmse_dtheta": 0.05918125435709953,
      "eval_objectnav_nopose_rmse_dx": 0.026989616453647614,
      "eval_objectnav_nopose_rmse_dy": 0.01000379677861929,
      "eval_objectnav_nopose_rmse_mean": 0.0320582240819931,
      "eval_objectnav_nopose_rotation_flip": 0.014878449030220509,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.32885196805000305,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2943350672721863,
      "eval_objectnav_pose_mae_dtheta": 0.036929115653038025,
      "eval_objectnav_pose_mae_dx": 0.011962413787841797,
      "eval_objectnav_pose_mae_dy": 0.004935659468173981,
      "eval_objectnav_pose_pose_mae_dtheta": 0.287404328584671,
      "eval_objectnav_pose_pose_mae_dx": 0.09542692452669144,
      "eval_objectnav_pose_pose_mae_dy": 0.05285343527793884,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4942251145839691,
      "eval_objectnav_pose_pose_rmse_dx": 0.21638920903205872,
      "eval_objectnav_pose_pose_rmse_dy": 0.12383905053138733,
      "eval_objectnav_pose_pose_rmse_mean": 0.27815112471580505,
      "eval_objectnav_pose_rmse_dtheta": 0.05447937920689583,
      "eval_objectnav_pose_rmse_dx": 0.02425338514149189,
      "eval_objectnav_pose_rmse_dy": 0.010127543471753597,
      "eval_objectnav_pose_rmse_mean": 0.029620103538036346,
      "eval_objectnav_pose_rotation_flip": 0.015397978946566582,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2943350672721863,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10894563794136047,
      "eval_pointnav_mae_dtheta": 0.012174082919955254,
      "eval_pointnav_mae_dx": 0.0029986235313117504,
      "eval_pointnav_mae_dy": 0.0028157017659395933,
      "eval_pointnav_pose_mae_dtheta": 0.08833657950162888,
      "eval_pointnav_pose_mae_dx": 0.034005653113126755,
      "eval_pointnav_pose_mae_dy": 0.03248298168182373,
      "eval_pointnav_pose_rmse_dtheta": 0.23209908604621887,
      "eval_pointnav_pose_rmse_dx": 0.09231636673212051,
      "eval_pointnav_pose_rmse_dy": 0.09623490273952484,
      "eval_pointnav_pose_rmse_mean": 0.14021679759025574,
      "eval_pointnav_rmse_dtheta": 0.027895651757717133,
      "eval_pointnav_rmse_dx": 0.008730779401957989,
      "eval_pointnav_rmse_dy": 0.007198745850473642,
      "eval_pointnav_rmse_mean": 0.014608393423259258,
      "eval_pointnav_rotation_flip": 0.005289006512612104,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10894563794136047,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 800
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.0372142724400669,
      "grad_norm": 0.35405853390693665,
      "learning_rate": 9.919377899645497e-06,
      "loss": 0.0852,
      "mae_dtheta": 0.011423286981880665,
      "mae_dx": 0.0018828955944627523,
      "mae_dy": 0.002797079039737582,
      "pose_mae_dtheta": 0.08026602864265442,
      "pose_mae_dx": 0.03198077902197838,
      "pose_mae_dy": 0.037831082940101624,
      "pose_rmse_dtheta": 0.18492937088012695,
      "pose_rmse_dx": 0.09200587868690491,
      "pose_rmse_dy": 0.07827410846948624,
      "pose_rmse_mean": 0.1184031218290329,
      "rmse_dtheta": 0.022417280822992325,
      "rmse_dx": 0.006816483102738857,
      "rmse_dy": 0.005404579918831587,
      "rmse_mean": 0.011546115390956402,
      "rotation_flip": 0.003458877792581916,
      "sparse_tokens": 32041.0,
      "step": 801,
      "turn_loss": 0.08571072667837143,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.03726073220590968,
      "grad_norm": 0.6893446445465088,
      "learning_rate": 9.91914124312824e-06,
      "loss": 0.0901,
      "mae_dtheta": 0.009851573966443539,
      "mae_dx": 0.0019862947519868612,
      "mae_dy": 0.002233040053397417,
      "pose_mae_dtheta": 0.07059267908334732,
      "pose_mae_dx": 0.026232456788420677,
      "pose_mae_dy": 0.030068477615714073,
      "pose_rmse_dtheta": 0.17911314964294434,
      "pose_rmse_dx": 0.07814078778028488,
      "pose_rmse_dy": 0.0771302580833435,
      "pose_rmse_mean": 0.11146140098571777,
      "rmse_dtheta": 0.02249079942703247,
      "rmse_dx": 0.006949546281248331,
      "rmse_dy": 0.005300937220454216,
      "rmse_mean": 0.01158042810857296,
      "rotation_flip": 0.0048851980827748775,
      "sparse_tokens": 32041.0,
      "step": 802,
      "turn_loss": 0.07200419157743454,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.03730719197175246,
      "grad_norm": 0.5020059943199158,
      "learning_rate": 9.918904242612794e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.009968467056751251,
      "mae_dx": 0.002414835151284933,
      "mae_dy": 0.0013295249082148075,
      "pose_mae_dtheta": 0.07941210269927979,
      "pose_mae_dx": 0.022071631625294685,
      "pose_mae_dy": 0.019911525771021843,
      "pose_rmse_dtheta": 0.2189851701259613,
      "pose_rmse_dx": 0.05516226589679718,
      "pose_rmse_dy": 0.05285072699189186,
      "pose_rmse_mean": 0.10899939388036728,
      "rmse_dtheta": 0.026209525763988495,
      "rmse_dx": 0.007131255231797695,
      "rmse_dy": 0.0029832886066287756,
      "rmse_mean": 0.012108023278415203,
      "rotation_flip": 0.004818221554160118,
      "sparse_tokens": 32201.0,
      "step": 803,
      "turn_loss": 0.07914119958877563,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.03735365173759524,
      "grad_norm": 0.6387302279472351,
      "learning_rate": 9.918666898115736e-06,
      "loss": 0.1924,
      "mae_dtheta": 0.04512184485793114,
      "mae_dx": 0.013985361903905869,
      "mae_dy": 0.008008049800992012,
      "pose_mae_dtheta": 0.3836372494697571,
      "pose_mae_dx": 0.12142731249332428,
      "pose_mae_dy": 0.10216309130191803,
      "pose_rmse_dtheta": 0.6249691843986511,
      "pose_rmse_dx": 0.23364800214767456,
      "pose_rmse_dy": 0.2433221936225891,
      "pose_rmse_mean": 0.3673131465911865,
      "rmse_dtheta": 0.06418462097644806,
      "rmse_dx": 0.02517174556851387,
      "rmse_dy": 0.015764208510518074,
      "rmse_mean": 0.03504019230604172,
      "rotation_flip": 0.016393441706895828,
      "sparse_tokens": 15428.0,
      "step": 804,
      "turn_loss": 0.3973792493343353,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 1663.0,
      "epoch": 0.03740011150343802,
      "grad_norm": 0.5389814376831055,
      "learning_rate": 9.918429209653662e-06,
      "loss": 0.1253,
      "mae_dtheta": 0.026479506865143776,
      "mae_dx": 0.007597710005939007,
      "mae_dy": 0.012809056788682938,
      "pose_mae_dtheta": 0.20556749403476715,
      "pose_mae_dx": 0.09297334402799606,
      "pose_mae_dy": 0.18901152908802032,
      "pose_rmse_dtheta": 0.3004584014415741,
      "pose_rmse_dx": 0.16888538002967834,
      "pose_rmse_dy": 0.3227781057357788,
      "pose_rmse_mean": 0.26404064893722534,
      "rmse_dtheta": 0.033413421362638474,
      "rmse_dx": 0.013920274563133717,
      "rmse_dy": 0.020644649863243103,
      "rmse_mean": 0.02265944890677929,
      "rotation_flip": 0.060975611209869385,
      "sparse_tokens": 1343.0,
      "step": 805,
      "turn_loss": 0.23301425576210022,
      "turns": 5.0,
      "turns_per_sample": 5.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.037446571269280804,
      "grad_norm": 0.44405892491340637,
      "learning_rate": 9.918191177243192e-06,
      "loss": 0.0869,
      "mae_dtheta": 0.029131071642041206,
      "mae_dx": 0.007655145600438118,
      "mae_dy": 0.005952075589448214,
      "pose_mae_dtheta": 0.24209098517894745,
      "pose_mae_dx": 0.07210476696491241,
      "pose_mae_dy": 0.09467297047376633,
      "pose_rmse_dtheta": 0.41127723455429077,
      "pose_rmse_dx": 0.16909271478652954,
      "pose_rmse_dy": 0.18830768764019012,
      "pose_rmse_mean": 0.2562258839607239,
      "rmse_dtheta": 0.044096045196056366,
      "rmse_dx": 0.01912280172109604,
      "rmse_dy": 0.009889855980873108,
      "rmse_mean": 0.02436956763267517,
      "rotation_flip": 0.011839708313345909,
      "sparse_tokens": 20311.0,
      "step": 806,
      "turn_loss": 0.24738992750644684,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.03749303103512358,
      "grad_norm": 0.5855317711830139,
      "learning_rate": 9.917952800900974e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.00870165042579174,
      "mae_dx": 0.0016805087216198444,
      "mae_dy": 0.0009563561761751771,
      "pose_mae_dtheta": 0.06155886501073837,
      "pose_mae_dx": 0.016260424628853798,
      "pose_mae_dy": 0.01632377691566944,
      "pose_rmse_dtheta": 0.1987513154745102,
      "pose_rmse_dx": 0.03945907577872276,
      "pose_rmse_dy": 0.04404227063059807,
      "pose_rmse_mean": 0.0940842255949974,
      "rmse_dtheta": 0.02573527954518795,
      "rmse_dx": 0.0047942656092345715,
      "rmse_dy": 0.0022801226004958153,
      "rmse_mean": 0.0109365563839674,
      "rotation_flip": 0.003799071302637458,
      "sparse_tokens": 32201.0,
      "step": 807,
      "turn_loss": 0.06069037318229675,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.037539490800966364,
      "grad_norm": 0.6869344711303711,
      "learning_rate": 9.917714080643677e-06,
      "loss": 0.1341,
      "mae_dtheta": 0.0162254236638546,
      "mae_dx": 0.0027188840322196484,
      "mae_dy": 0.003920618444681168,
      "pose_mae_dtheta": 0.11060961335897446,
      "pose_mae_dx": 0.03892807289958,
      "pose_mae_dy": 0.048097651451826096,
      "pose_rmse_dtheta": 0.24662035703659058,
      "pose_rmse_dx": 0.1010642871260643,
      "pose_rmse_dy": 0.11261612176895142,
      "pose_rmse_mean": 0.15343359112739563,
      "rmse_dtheta": 0.030137240886688232,
      "rmse_dx": 0.008684654720127583,
      "rmse_dy": 0.008200094103813171,
      "rmse_mean": 0.01567399688065052,
      "rotation_flip": 0.006412419956177473,
      "sparse_tokens": 32073.0,
      "step": 808,
      "turn_loss": 0.13910259306430817,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.03758595056680914,
      "grad_norm": 0.33437222242355347,
      "learning_rate": 9.917475016487994e-06,
      "loss": 0.0947,
      "mae_dtheta": 0.011831579729914665,
      "mae_dx": 0.0024494007229804993,
      "mae_dy": 0.002676482545211911,
      "pose_mae_dtheta": 0.0845518559217453,
      "pose_mae_dx": 0.028886906802654266,
      "pose_mae_dy": 0.034325309097766876,
      "pose_rmse_dtheta": 0.17047622799873352,
      "pose_rmse_dx": 0.06866121292114258,
      "pose_rmse_dy": 0.08728405088186264,
      "pose_rmse_mean": 0.10880716890096664,
      "rmse_dtheta": 0.02330068126320839,
      "rmse_dx": 0.007025607395917177,
      "rmse_dy": 0.005517533514648676,
      "rmse_mean": 0.011947941035032272,
      "rotation_flip": 0.00554894981905818,
      "sparse_tokens": 32153.0,
      "step": 809,
      "turn_loss": 0.10502730309963226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.037632410332651925,
      "grad_norm": 0.6840364336967468,
      "learning_rate": 9.917235608450645e-06,
      "loss": 0.1812,
      "mae_dtheta": 0.030194154009222984,
      "mae_dx": 0.009724627248942852,
      "mae_dy": 0.003750717733055353,
      "pose_mae_dtheta": 0.251009464263916,
      "pose_mae_dx": 0.07376652956008911,
      "pose_mae_dy": 0.04971841722726822,
      "pose_rmse_dtheta": 0.5245513916015625,
      "pose_rmse_dx": 0.18831419944763184,
      "pose_rmse_dy": 0.12761647999286652,
      "pose_rmse_mean": 0.28016069531440735,
      "rmse_dtheta": 0.05287247151136398,
      "rmse_dx": 0.022023582831025124,
      "rmse_dy": 0.008043669164180756,
      "rmse_mean": 0.02764657512307167,
      "rotation_flip": 0.010273972526192665,
      "sparse_tokens": 17767.0,
      "step": 810,
      "turn_loss": 0.21734167635440826,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.0376788700984947,
      "grad_norm": 0.4578807055950165,
      "learning_rate": 9.916995856548371e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.02607784792780876,
      "mae_dx": 0.006636456586420536,
      "mae_dy": 0.005530841648578644,
      "pose_mae_dtheta": 0.21706514060497284,
      "pose_mae_dx": 0.06347272545099258,
      "pose_mae_dy": 0.06760081648826599,
      "pose_rmse_dtheta": 0.35703879594802856,
      "pose_rmse_dx": 0.138854518532753,
      "pose_rmse_dy": 0.15804511308670044,
      "pose_rmse_mean": 0.21797947585582733,
      "rmse_dtheta": 0.04107536002993584,
      "rmse_dx": 0.015491996891796589,
      "rmse_dy": 0.010811672545969486,
      "rmse_mean": 0.02245967648923397,
      "rotation_flip": 0.007990867830812931,
      "sparse_tokens": 14917.0,
      "step": 811,
      "turn_loss": 0.22949287295341492,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.037725329864337485,
      "grad_norm": 0.5613006353378296,
      "learning_rate": 9.916755760797936e-06,
      "loss": 0.1594,
      "mae_dtheta": 0.01407075859606266,
      "mae_dx": 0.0027917255647480488,
      "mae_dy": 0.003455003257840872,
      "pose_mae_dtheta": 0.09331969171762466,
      "pose_mae_dx": 0.03569899499416351,
      "pose_mae_dy": 0.04737454280257225,
      "pose_rmse_dtheta": 0.19606797397136688,
      "pose_rmse_dx": 0.10588143765926361,
      "pose_rmse_dy": 0.10797244310379028,
      "pose_rmse_mean": 0.13664062321186066,
      "rmse_dtheta": 0.028335653245449066,
      "rmse_dx": 0.009828710928559303,
      "rmse_dy": 0.007477535866200924,
      "rmse_mean": 0.015213966369628906,
      "rotation_flip": 0.006738544441759586,
      "sparse_tokens": 32041.0,
      "step": 812,
      "turn_loss": 0.14387036859989166,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.03777178963018026,
      "grad_norm": 0.4579381048679352,
      "learning_rate": 9.916515321216132e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.01411635335534811,
      "mae_dx": 0.0025797535199671984,
      "mae_dy": 0.00362947559915483,
      "pose_mae_dtheta": 0.10168348252773285,
      "pose_mae_dx": 0.04208675026893616,
      "pose_mae_dy": 0.04607296735048294,
      "pose_rmse_dtheta": 0.22500509023666382,
      "pose_rmse_dx": 0.10702583193778992,
      "pose_rmse_dy": 0.11585108190774918,
      "pose_rmse_mean": 0.14929400384426117,
      "rmse_dtheta": 0.028237521648406982,
      "rmse_dx": 0.007055626716464758,
      "rmse_dy": 0.007922694087028503,
      "rmse_mean": 0.014405280351638794,
      "rotation_flip": 0.006362275220453739,
      "sparse_tokens": 32121.0,
      "step": 813,
      "turn_loss": 0.1031203642487526,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.037818249396023046,
      "grad_norm": 0.45558884739875793,
      "learning_rate": 9.916274537819774e-06,
      "loss": 0.1222,
      "mae_dtheta": 0.008389633148908615,
      "mae_dx": 0.0019893988501280546,
      "mae_dy": 0.00043203416862525046,
      "pose_mae_dtheta": 0.0635683611035347,
      "pose_mae_dx": 0.015862558037042618,
      "pose_mae_dy": 0.006936218123883009,
      "pose_rmse_dtheta": 0.23623311519622803,
      "pose_rmse_dx": 0.039174437522888184,
      "pose_rmse_dy": 0.017584623768925667,
      "pose_rmse_mean": 0.09766405820846558,
      "rmse_dtheta": 0.02861868031322956,
      "rmse_dx": 0.005355354398488998,
      "rmse_dy": 0.000875886355061084,
      "rmse_mean": 0.011616641655564308,
      "rotation_flip": 0.0029922202229499817,
      "sparse_tokens": 32217.0,
      "step": 814,
      "turn_loss": 0.05641380324959755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.03786470916186582,
      "grad_norm": 0.657967746257782,
      "learning_rate": 9.916033410625698e-06,
      "loss": 0.2236,
      "mae_dtheta": 0.037321459501981735,
      "mae_dx": 0.01462047453969717,
      "mae_dy": 0.006535675376653671,
      "pose_mae_dtheta": 0.2903192639350891,
      "pose_mae_dx": 0.1290206015110016,
      "pose_mae_dy": 0.10571695119142532,
      "pose_rmse_dtheta": 0.4463958740234375,
      "pose_rmse_dx": 0.22420407831668854,
      "pose_rmse_dy": 0.21579687297344208,
      "pose_rmse_mean": 0.2954656183719635,
      "rmse_dtheta": 0.054328154772520065,
      "rmse_dx": 0.026900799944996834,
      "rmse_dy": 0.010958664119243622,
      "rmse_mean": 0.030729208141565323,
      "rotation_flip": 0.015015015378594398,
      "sparse_tokens": 5875.0,
      "step": 815,
      "turn_loss": 0.3603333532810211,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 2309.0,
      "epoch": 0.037911168927708606,
      "grad_norm": 0.693133533000946,
      "learning_rate": 9.915791939650767e-06,
      "loss": 0.1808,
      "mae_dtheta": 0.05009125918149948,
      "mae_dx": 0.02401295304298401,
      "mae_dy": 0.007323115132749081,
      "pose_mae_dtheta": 0.418822705745697,
      "pose_mae_dx": 0.11307922750711441,
      "pose_mae_dy": 0.09970191866159439,
      "pose_rmse_dtheta": 0.6976184248924255,
      "pose_rmse_dx": 0.20859158039093018,
      "pose_rmse_dy": 0.19097387790679932,
      "pose_rmse_mean": 0.3657279908657074,
      "rmse_dtheta": 0.06494437903165817,
      "rmse_dx": 0.036400772631168365,
      "rmse_dy": 0.011056521907448769,
      "rmse_mean": 0.03746722638607025,
      "rotation_flip": 0.00917431153357029,
      "sparse_tokens": 1895.0,
      "step": 816,
      "turn_loss": 0.5482964515686035,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.03795762869355138,
      "grad_norm": 0.4674582779407501,
      "learning_rate": 9.915550124911866e-06,
      "loss": 0.1605,
      "mae_dtheta": 0.029309820383787155,
      "mae_dx": 0.012139085680246353,
      "mae_dy": 0.003402253845706582,
      "pose_mae_dtheta": 0.21649953722953796,
      "pose_mae_dx": 0.09437573701143265,
      "pose_mae_dy": 0.05177430063486099,
      "pose_rmse_dtheta": 0.4188043475151062,
      "pose_rmse_dx": 0.2140599936246872,
      "pose_rmse_dy": 0.11510834842920303,
      "pose_rmse_mean": 0.2493242472410202,
      "rmse_dtheta": 0.048866551369428635,
      "rmse_dx": 0.02438805066049099,
      "rmse_dy": 0.006455120164901018,
      "rmse_mean": 0.02656990848481655,
      "rotation_flip": 0.013245033100247383,
      "sparse_tokens": 10450.0,
      "step": 817,
      "turn_loss": 0.26568731665611267,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.03800408845939417,
      "grad_norm": 1.389355182647705,
      "learning_rate": 9.91530796642591e-06,
      "loss": 0.2355,
      "mae_dtheta": 0.03871417045593262,
      "mae_dx": 0.011105727404356003,
      "mae_dy": 0.0063861352391541,
      "pose_mae_dtheta": 0.2677796185016632,
      "pose_mae_dx": 0.07833350449800491,
      "pose_mae_dy": 0.04575271159410477,
      "pose_rmse_dtheta": 0.4459211528301239,
      "pose_rmse_dx": 0.2099597156047821,
      "pose_rmse_dy": 0.09462224692106247,
      "pose_rmse_mean": 0.25016772747039795,
      "rmse_dtheta": 0.05428425595164299,
      "rmse_dx": 0.022209828719496727,
      "rmse_dy": 0.014423954300582409,
      "rmse_mean": 0.03030601143836975,
      "rotation_flip": 0.022026430815458298,
      "sparse_tokens": 3902.0,
      "step": 818,
      "turn_loss": 0.31202954053878784,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 13282.0,
      "epoch": 0.038050548225236944,
      "grad_norm": 0.5123974680900574,
      "learning_rate": 9.915065464209826e-06,
      "loss": 0.1544,
      "mae_dtheta": 0.0335252583026886,
      "mae_dx": 0.009643863886594772,
      "mae_dy": 0.0060056704096496105,
      "pose_mae_dtheta": 0.2742184102535248,
      "pose_mae_dx": 0.07385610789060593,
      "pose_mae_dy": 0.07659225165843964,
      "pose_rmse_dtheta": 0.500066876411438,
      "pose_rmse_dx": 0.2022651731967926,
      "pose_rmse_dy": 0.14846886694431305,
      "pose_rmse_mean": 0.2836003005504608,
      "rmse_dtheta": 0.05149300768971443,
      "rmse_dx": 0.022318458184599876,
      "rmse_dy": 0.011205984279513359,
      "rmse_mean": 0.028339151293039322,
      "rotation_flip": 0.013867488130927086,
      "sparse_tokens": 10377.0,
      "step": 819,
      "turn_loss": 0.22517730295658112,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.03809700799107973,
      "grad_norm": 0.3923508822917938,
      "learning_rate": 9.914822618280577e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.045144855976104736,
      "mae_dx": 0.010138187557458878,
      "mae_dy": 0.009836443699896336,
      "pose_mae_dtheta": 0.3966064453125,
      "pose_mae_dx": 0.07585956156253815,
      "pose_mae_dy": 0.12658776342868805,
      "pose_rmse_dtheta": 0.6656913757324219,
      "pose_rmse_dx": 0.1870208978652954,
      "pose_rmse_dy": 0.2669532001018524,
      "pose_rmse_mean": 0.37322184443473816,
      "rmse_dtheta": 0.06529108434915543,
      "rmse_dx": 0.02183973416686058,
      "rmse_dy": 0.020597364753484726,
      "rmse_mean": 0.035909395664930344,
      "rotation_flip": 0.015021459199488163,
      "sparse_tokens": 7780.0,
      "step": 820,
      "turn_loss": 0.4193435609340668,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.038143467756922504,
      "grad_norm": 0.3254298269748688,
      "learning_rate": 9.914579428655144e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.015895932912826538,
      "mae_dx": 0.0028758107218891382,
      "mae_dy": 0.003315966809168458,
      "pose_mae_dtheta": 0.11000718176364899,
      "pose_mae_dx": 0.0355646051466465,
      "pose_mae_dy": 0.04711182042956352,
      "pose_rmse_dtheta": 0.2236648052930832,
      "pose_rmse_dx": 0.0865352526307106,
      "pose_rmse_dy": 0.10223053395748138,
      "pose_rmse_mean": 0.1374768614768982,
      "rmse_dtheta": 0.029818130657076836,
      "rmse_dx": 0.008531267754733562,
      "rmse_dy": 0.006706394720822573,
      "rmse_mean": 0.01501859724521637,
      "rotation_flip": 0.006774557754397392,
      "sparse_tokens": 32105.0,
      "step": 821,
      "turn_loss": 0.12371134757995605,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18831.0,
      "epoch": 0.03818992752276529,
      "grad_norm": 0.6005182266235352,
      "learning_rate": 9.914335895350536e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.033985335379838943,
      "mae_dx": 0.011933554895222187,
      "mae_dy": 0.0056183673441410065,
      "pose_mae_dtheta": 0.2634557783603668,
      "pose_mae_dx": 0.10156285762786865,
      "pose_mae_dy": 0.07752591371536255,
      "pose_rmse_dtheta": 0.504651665687561,
      "pose_rmse_dx": 0.23311956226825714,
      "pose_rmse_dy": 0.1772005259990692,
      "pose_rmse_mean": 0.30499058961868286,
      "rmse_dtheta": 0.05375879630446434,
      "rmse_dx": 0.02512253075838089,
      "rmse_dy": 0.010026756674051285,
      "rmse_mean": 0.029636025428771973,
      "rotation_flip": 0.010440835729241371,
      "sparse_tokens": 15981.0,
      "step": 822,
      "turn_loss": 0.25200173258781433,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.038236387288608065,
      "grad_norm": 0.4268536865711212,
      "learning_rate": 9.914092018383778e-06,
      "loss": 0.1263,
      "mae_dtheta": 0.017539016902446747,
      "mae_dx": 0.0032578252721577883,
      "mae_dy": 0.004820330534130335,
      "pose_mae_dtheta": 0.1231926754117012,
      "pose_mae_dx": 0.04297159984707832,
      "pose_mae_dy": 0.05387847498059273,
      "pose_rmse_dtheta": 0.23655986785888672,
      "pose_rmse_dx": 0.10106401145458221,
      "pose_rmse_dy": 0.11766106635332108,
      "pose_rmse_mean": 0.15176165103912354,
      "rmse_dtheta": 0.030333386734128,
      "rmse_dx": 0.009289058856666088,
      "rmse_dy": 0.009576921351253986,
      "rmse_mean": 0.016399789601564407,
      "rotation_flip": 0.00433302391320467,
      "sparse_tokens": 32105.0,
      "step": 823,
      "turn_loss": 0.16035860776901245,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.03828284705445085,
      "grad_norm": 0.6055700182914734,
      "learning_rate": 9.913847797771929e-06,
      "loss": 0.1404,
      "mae_dtheta": 0.008427957072854042,
      "mae_dx": 0.0020058639347553253,
      "mae_dy": 0.0015887696063145995,
      "pose_mae_dtheta": 0.06528783589601517,
      "pose_mae_dx": 0.023266015574336052,
      "pose_mae_dy": 0.024013588204979897,
      "pose_rmse_dtheta": 0.1716165840625763,
      "pose_rmse_dx": 0.05715316906571388,
      "pose_rmse_dy": 0.06054695323109627,
      "pose_rmse_mean": 0.09643890708684921,
      "rmse_dtheta": 0.018821120262145996,
      "rmse_dx": 0.005823605228215456,
      "rmse_dy": 0.0033739551436156034,
      "rmse_mean": 0.009339559823274612,
      "rotation_flip": 0.0012340600369498134,
      "sparse_tokens": 32169.0,
      "step": 824,
      "turn_loss": 0.07018488645553589,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33414.0,
      "epoch": 0.038329306820293625,
      "grad_norm": 0.3227989673614502,
      "learning_rate": 9.913603233532067e-06,
      "loss": 0.1019,
      "mae_dtheta": 0.02781602554023266,
      "mae_dx": 0.007058341521769762,
      "mae_dy": 0.0039628371596336365,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.32279902696609497,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.96597290039062,
      "model/head/act_norm_mean": 101.55825242718447,
      "model/head/act_norm_min": 62.88258743286133,
      "model/head/act_over_embed": 69.79178187130054,
      "model/head/grad_frac": 0.11779658496379852,
      "model/head/grad_norm": 0.038024622946977615,
      "model/head/grad_zero_frac": 0.00019924667140003294,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6739134557038835,
      "model/head/update_ratio": 0.0006639793864451349,
      "model/head/weight_delta": 3.17010760307312,
      "model/head/weight_delta_rel": 0.05561307817697525,
      "model/head/weight_norm": 57.26777648925781,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4111782908439636,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41112415607158953,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41106632351875305,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28252836905738754,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10011663287878036,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03231755271553993,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.49417818509615385,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010536805493757129,
      "model/modality_embedder.encoders.pose/weight_delta": 0.9557168483734131,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.031226247549057007,
      "model/modality_embedder.encoders.pose/weight_norm": 30.671112060546875,
      "model/modality_embedder/grad_frac": 0.10011663287878036,
      "model/modality_embedder/grad_norm": 0.03231755271553993,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.49417818509615385,
      "model/modality_embedder/update_ratio": 0.0010536805493757129,
      "model/modality_embedder/weight_delta": 0.9557168483734131,
      "model/modality_embedder/weight_delta_rel": 0.031226247549057007,
      "model/modality_embedder/weight_norm": 30.671112060546875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.96832275390625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.503871937124366,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.976508140563965,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.46487147976033,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09405367076396942,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03036043420433998,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001103882910683751,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.4801063537597656,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.01749536581337452,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.50330924987793,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.90623474121094,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.463650023116042,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.576542854309082,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.12443996603782,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09351489692926407,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030186517164111137,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010414363350719213,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.5747765898704529,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.01991070993244648,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.98546600341797,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.9321517944336,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.210823123747883,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.898653030395508,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.325113678084303,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10055190324783325,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03245805576443672,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010853043058887124,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.5973331332206726,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.020057328045368195,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.906869888305664,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.31031799316406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.175486881645863,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.331466674804688,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.67524900598369,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10394034534692764,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03355184197425842,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011430798331275582,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.5047680735588074,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.017250576987862587,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.352142333984375,
      "model/normalizer/grad_frac": 0.3867657482624054,
      "model/normalizer/grad_norm": 0.12484760582447052,
      "model/normalizer/grad_zero_frac": 0.00022098507906775922,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016052481951192021,
      "model/normalizer/weight_delta": 1.111602544784546,
      "model/normalizer/weight_delta_rel": 0.014316797256469727,
      "model/normalizer/weight_norm": 77.77464294433594,
      "pose_mae_dtheta": 0.2042173147201538,
      "pose_mae_dx": 0.05486706644296646,
      "pose_mae_dy": 0.0465194508433342,
      "pose_rmse_dtheta": 0.38130098581314087,
      "pose_rmse_dx": 0.1387808620929718,
      "pose_rmse_dy": 0.12473529577255249,
      "pose_rmse_mean": 0.21493905782699585,
      "rmse_dtheta": 0.043669573962688446,
      "rmse_dx": 0.016474248841404915,
      "rmse_dy": 0.00850361306220293,
      "rmse_mean": 0.022882480174303055,
      "rotation_flip": 0.01071203500032425,
      "sparse_tokens": 26248.0,
      "step": 825,
      "turn_loss": 0.19763579964637756,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.03837576658613641,
      "grad_norm": 0.5703210234642029,
      "learning_rate": 9.913358325681292e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.012460239231586456,
      "mae_dx": 0.0019802285823971033,
      "mae_dy": 0.0024155990686267614,
      "pose_mae_dtheta": 0.08229130506515503,
      "pose_mae_dx": 0.027369309216737747,
      "pose_mae_dy": 0.028322944417595863,
      "pose_rmse_dtheta": 0.20468993484973907,
      "pose_rmse_dx": 0.06910030543804169,
      "pose_rmse_dy": 0.07159889489412308,
      "pose_rmse_mean": 0.11512970924377441,
      "rmse_dtheta": 0.026420531794428825,
      "rmse_dx": 0.006419890560209751,
      "rmse_dy": 0.0055914949625730515,
      "rmse_mean": 0.012810640037059784,
      "rotation_flip": 0.004399999976158142,
      "sparse_tokens": 32105.0,
      "step": 826,
      "turn_loss": 0.08439942449331284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.038422226351979186,
      "grad_norm": 0.46172603964805603,
      "learning_rate": 9.913113074236734e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.006452347617596388,
      "mae_dx": 0.0018558602314442396,
      "mae_dy": 0.0011016345815733075,
      "pose_mae_dtheta": 0.04824131354689598,
      "pose_mae_dx": 0.019291464239358902,
      "pose_mae_dy": 0.014052184298634529,
      "pose_rmse_dtheta": 0.15698687732219696,
      "pose_rmse_dx": 0.0739230066537857,
      "pose_rmse_dy": 0.03736646845936775,
      "pose_rmse_mean": 0.0894254595041275,
      "rmse_dtheta": 0.01903959922492504,
      "rmse_dx": 0.007538477424532175,
      "rmse_dy": 0.0026790816336870193,
      "rmse_mean": 0.009752386249601841,
      "rotation_flip": 0.0014720313483849168,
      "sparse_tokens": 32121.0,
      "step": 827,
      "turn_loss": 0.05500069633126259,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.03846868611782197,
      "grad_norm": 0.562069296836853,
      "learning_rate": 9.91286747921554e-06,
      "loss": 0.176,
      "mae_dtheta": 0.018224135041236877,
      "mae_dx": 0.004509294871240854,
      "mae_dy": 0.006070049479603767,
      "pose_mae_dtheta": 0.1361570805311203,
      "pose_mae_dx": 0.05292457714676857,
      "pose_mae_dy": 0.056395404040813446,
      "pose_rmse_dtheta": 0.2982672154903412,
      "pose_rmse_dx": 0.14298337697982788,
      "pose_rmse_dy": 0.1456373780965805,
      "pose_rmse_mean": 0.1956293284893036,
      "rmse_dtheta": 0.03535563126206398,
      "rmse_dx": 0.012861831113696098,
      "rmse_dy": 0.014766518026590347,
      "rmse_mean": 0.020994659513235092,
      "rotation_flip": 0.006581353023648262,
      "sparse_tokens": 32089.0,
      "step": 828,
      "turn_loss": 0.18324929475784302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.038515145883664746,
      "grad_norm": 0.45809468626976013,
      "learning_rate": 9.912621540634889e-06,
      "loss": 0.1297,
      "mae_dtheta": 0.01125653088092804,
      "mae_dx": 0.0020281337201595306,
      "mae_dy": 0.0027062762528657913,
      "pose_mae_dtheta": 0.07118187844753265,
      "pose_mae_dx": 0.025330664590001106,
      "pose_mae_dy": 0.029454099014401436,
      "pose_rmse_dtheta": 0.16078366339206696,
      "pose_rmse_dx": 0.064825639128685,
      "pose_rmse_dy": 0.0678575336933136,
      "pose_rmse_mean": 0.09782227873802185,
      "rmse_dtheta": 0.023913752287626266,
      "rmse_dx": 0.00638588797301054,
      "rmse_dy": 0.0062465486116707325,
      "rmse_mean": 0.012182063423097134,
      "rotation_flip": 0.004660194274038076,
      "sparse_tokens": 32073.0,
      "step": 829,
      "turn_loss": 0.1012808084487915,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.03856160564950753,
      "grad_norm": 0.4706191420555115,
      "learning_rate": 9.912375258511972e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.012377150356769562,
      "mae_dx": 0.0023602198343724012,
      "mae_dy": 0.0022994077298790216,
      "pose_mae_dtheta": 0.08562010526657104,
      "pose_mae_dx": 0.028464222326874733,
      "pose_mae_dy": 0.033040329813957214,
      "pose_rmse_dtheta": 0.19703099131584167,
      "pose_rmse_dx": 0.07379186898469925,
      "pose_rmse_dy": 0.07690836489200592,
      "pose_rmse_mean": 0.11591041088104248,
      "rmse_dtheta": 0.024902746081352234,
      "rmse_dx": 0.007725227158516645,
      "rmse_dy": 0.00483934348449111,
      "rmse_mean": 0.012489105574786663,
      "rotation_flip": 0.0040964954532682896,
      "sparse_tokens": 32041.0,
      "step": 830,
      "turn_loss": 0.10119684040546417,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.03860806541535031,
      "grad_norm": 1.038195252418518,
      "learning_rate": 9.91212863286402e-06,
      "loss": 0.2085,
      "mae_dtheta": 0.03228252753615379,
      "mae_dx": 0.0056696669198572636,
      "mae_dy": 0.005001173820346594,
      "pose_mae_dtheta": 0.2690863609313965,
      "pose_mae_dx": 0.05138253793120384,
      "pose_mae_dy": 0.07226550579071045,
      "pose_rmse_dtheta": 0.4588746130466461,
      "pose_rmse_dx": 0.10433521121740341,
      "pose_rmse_dy": 0.14772389829158783,
      "pose_rmse_mean": 0.23697791993618011,
      "rmse_dtheta": 0.05051011964678764,
      "rmse_dx": 0.014244732446968555,
      "rmse_dy": 0.008811297826468945,
      "rmse_mean": 0.024522049352526665,
      "rotation_flip": 0.0018761726096272469,
      "sparse_tokens": 8535.0,
      "step": 831,
      "turn_loss": 0.19726043939590454,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.03865452518119308,
      "grad_norm": 0.7055264711380005,
      "learning_rate": 9.911881663708275e-06,
      "loss": 0.1142,
      "mae_dtheta": 0.012359409593045712,
      "mae_dx": 0.002708020620048046,
      "mae_dy": 0.004117748700082302,
      "pose_mae_dtheta": 0.08928939700126648,
      "pose_mae_dx": 0.03395690396428108,
      "pose_mae_dy": 0.034747395664453506,
      "pose_rmse_dtheta": 0.22877316176891327,
      "pose_rmse_dx": 0.09151782095432281,
      "pose_rmse_dy": 0.10820937901735306,
      "pose_rmse_mean": 0.14283345639705658,
      "rmse_dtheta": 0.02909861132502556,
      "rmse_dx": 0.0073203397914767265,
      "rmse_dy": 0.011878668330609798,
      "rmse_mean": 0.01609920710325241,
      "rotation_flip": 0.004304160829633474,
      "sparse_tokens": 32057.0,
      "step": 832,
      "turn_loss": 0.10603553801774979,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35688.0,
      "epoch": 0.03870098494703587,
      "grad_norm": 0.5188357830047607,
      "learning_rate": 9.91163435106201e-06,
      "loss": 0.1481,
      "mae_dtheta": 0.03361782804131508,
      "mae_dx": 0.011014368385076523,
      "mae_dy": 0.00456653768196702,
      "pose_mae_dtheta": 0.25570905208587646,
      "pose_mae_dx": 0.08715491741895676,
      "pose_mae_dy": 0.05268677696585655,
      "pose_rmse_dtheta": 0.49738404154777527,
      "pose_rmse_dx": 0.18844683468341827,
      "pose_rmse_dy": 0.11440526694059372,
      "pose_rmse_mean": 0.266745388507843,
      "rmse_dtheta": 0.05343623086810112,
      "rmse_dx": 0.02300710789859295,
      "rmse_dy": 0.008335605263710022,
      "rmse_mean": 0.028259648010134697,
      "rotation_flip": 0.011785503476858139,
      "sparse_tokens": 26526.0,
      "step": 833,
      "turn_loss": 0.29064175486564636,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 32339.0,
      "epoch": 0.038747444712878644,
      "grad_norm": 0.6910311579704285,
      "learning_rate": 9.911386694942518e-06,
      "loss": 0.215,
      "mae_dtheta": 0.04293091967701912,
      "mae_dx": 0.0148269422352314,
      "mae_dy": 0.007859981618821621,
      "pose_mae_dtheta": 0.38096484541893005,
      "pose_mae_dx": 0.13471703231334686,
      "pose_mae_dy": 0.08214815706014633,
      "pose_rmse_dtheta": 0.6269356608390808,
      "pose_rmse_dx": 0.2909909784793854,
      "pose_rmse_dy": 0.18957366049289703,
      "pose_rmse_mean": 0.3691667914390564,
      "rmse_dtheta": 0.06092918664216995,
      "rmse_dx": 0.028399761766195297,
      "rmse_dy": 0.01891755498945713,
      "rmse_mean": 0.03608216717839241,
      "rotation_flip": 0.014218009077012539,
      "sparse_tokens": 26390.0,
      "step": 834,
      "turn_loss": 0.38644927740097046,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.03879390447872143,
      "grad_norm": 0.6413556337356567,
      "learning_rate": 9.91113869536712e-06,
      "loss": 0.1903,
      "mae_dtheta": 0.015700697898864746,
      "mae_dx": 0.003928820602595806,
      "mae_dy": 0.005044387653470039,
      "pose_mae_dtheta": 0.11059587448835373,
      "pose_mae_dx": 0.05494850128889084,
      "pose_mae_dy": 0.05457308888435364,
      "pose_rmse_dtheta": 0.2336510419845581,
      "pose_rmse_dx": 0.12683577835559845,
      "pose_rmse_dy": 0.12618477642536163,
      "pose_rmse_mean": 0.16222386062145233,
      "rmse_dtheta": 0.028819827362895012,
      "rmse_dx": 0.00976055022329092,
      "rmse_dy": 0.01014061737805605,
      "rmse_mean": 0.016240332275629044,
      "rotation_flip": 0.008212877437472343,
      "sparse_tokens": 32121.0,
      "step": 835,
      "turn_loss": 0.14531274139881134,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.038840364244564204,
      "grad_norm": 0.5193073153495789,
      "learning_rate": 9.910890352353154e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.020475581288337708,
      "mae_dx": 0.0025914583820849657,
      "mae_dy": 0.005734686739742756,
      "pose_mae_dtheta": 0.1480780392885208,
      "pose_mae_dx": 0.04830440133810043,
      "pose_mae_dy": 0.0662950947880745,
      "pose_rmse_dtheta": 0.3013271391391754,
      "pose_rmse_dx": 0.13990174233913422,
      "pose_rmse_dy": 0.1472993642091751,
      "pose_rmse_mean": 0.19617608189582825,
      "rmse_dtheta": 0.03419957682490349,
      "rmse_dx": 0.006991685833781958,
      "rmse_dy": 0.011389373801648617,
      "rmse_mean": 0.017526879906654358,
      "rotation_flip": 0.00699533661827445,
      "sparse_tokens": 32057.0,
      "step": 836,
      "turn_loss": 0.15852519869804382,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.03888682401040699,
      "grad_norm": 0.5693709850311279,
      "learning_rate": 9.910641665917991e-06,
      "loss": 0.1984,
      "mae_dtheta": 0.035265423357486725,
      "mae_dx": 0.01013029832392931,
      "mae_dy": 0.005794313736259937,
      "pose_mae_dtheta": 0.28388848900794983,
      "pose_mae_dx": 0.09152967482805252,
      "pose_mae_dy": 0.08398434519767761,
      "pose_rmse_dtheta": 0.48259663581848145,
      "pose_rmse_dx": 0.18768464028835297,
      "pose_rmse_dy": 0.17227034270763397,
      "pose_rmse_mean": 0.2808505594730377,
      "rmse_dtheta": 0.0519883930683136,
      "rmse_dx": 0.02122325263917446,
      "rmse_dy": 0.009478305466473103,
      "rmse_mean": 0.027563318610191345,
      "rotation_flip": 0.01403061207383871,
      "sparse_tokens": 12912.0,
      "step": 837,
      "turn_loss": 0.2501453757286072,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.038933283776249765,
      "grad_norm": 0.7115051746368408,
      "learning_rate": 9.910392636079021e-06,
      "loss": 0.1828,
      "mae_dtheta": 0.03203517943620682,
      "mae_dx": 0.008622298017144203,
      "mae_dy": 0.005516706965863705,
      "pose_mae_dtheta": 0.2526414394378662,
      "pose_mae_dx": 0.0716996118426323,
      "pose_mae_dy": 0.0464521199464798,
      "pose_rmse_dtheta": 0.46837592124938965,
      "pose_rmse_dx": 0.15181304514408112,
      "pose_rmse_dy": 0.12132241576910019,
      "pose_rmse_mean": 0.24717044830322266,
      "rmse_dtheta": 0.051857348531484604,
      "rmse_dx": 0.018313148990273476,
      "rmse_dy": 0.013853110373020172,
      "rmse_mean": 0.02800787054002285,
      "rotation_flip": 0.012285011820495129,
      "sparse_tokens": 21200.0,
      "step": 838,
      "turn_loss": 0.2644897997379303,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.03897974354209255,
      "grad_norm": 0.45144397020339966,
      "learning_rate": 9.910143262853659e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.036973826587200165,
      "mae_dx": 0.013346501626074314,
      "mae_dy": 0.004877537488937378,
      "pose_mae_dtheta": 0.2792985141277313,
      "pose_mae_dx": 0.12789122760295868,
      "pose_mae_dy": 0.06774918735027313,
      "pose_rmse_dtheta": 0.4402267336845398,
      "pose_rmse_dx": 0.2737876772880554,
      "pose_rmse_dy": 0.15375983715057373,
      "pose_rmse_mean": 0.28925809264183044,
      "rmse_dtheta": 0.05385959520936012,
      "rmse_dx": 0.026950864121317863,
      "rmse_dy": 0.008252803236246109,
      "rmse_mean": 0.029687752947211266,
      "rotation_flip": 0.013513513840734959,
      "sparse_tokens": 5946.0,
      "step": 839,
      "turn_loss": 0.2963947355747223,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.039026203307935325,
      "grad_norm": 0.5116018652915955,
      "learning_rate": 9.909893546259341e-06,
      "loss": 0.169,
      "mae_dtheta": 0.03701990097761154,
      "mae_dx": 0.01101186778396368,
      "mae_dy": 0.0074396985583007336,
      "pose_mae_dtheta": 0.3247710168361664,
      "pose_mae_dx": 0.07789318263530731,
      "pose_mae_dy": 0.054400477558374405,
      "pose_rmse_dtheta": 0.546411395072937,
      "pose_rmse_dx": 0.17287185788154602,
      "pose_rmse_dy": 0.11419466137886047,
      "pose_rmse_mean": 0.2778259515762329,
      "rmse_dtheta": 0.05563386157155037,
      "rmse_dx": 0.022821323946118355,
      "rmse_dy": 0.014981959946453571,
      "rmse_mean": 0.031145717948675156,
      "rotation_flip": 0.010088272392749786,
      "sparse_tokens": 13508.0,
      "step": 840,
      "turn_loss": 0.37738949060440063,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.03907266307377811,
      "grad_norm": 0.7724581360816956,
      "learning_rate": 9.909643486313533e-06,
      "loss": 0.1894,
      "mae_dtheta": 0.02912919409573078,
      "mae_dx": 0.006112442351877689,
      "mae_dy": 0.0045974585227668285,
      "pose_mae_dtheta": 0.20900149643421173,
      "pose_mae_dx": 0.0457753911614418,
      "pose_mae_dy": 0.040353644639253616,
      "pose_rmse_dtheta": 0.4274628758430481,
      "pose_rmse_dx": 0.10119084268808365,
      "pose_rmse_dy": 0.08953078091144562,
      "pose_rmse_mean": 0.20606151223182678,
      "rmse_dtheta": 0.04679380729794502,
      "rmse_dx": 0.015003844164311886,
      "rmse_dy": 0.009470290504395962,
      "rmse_mean": 0.023755980655550957,
      "rotation_flip": 0.003267973894253373,
      "sparse_tokens": 5290.0,
      "step": 841,
      "turn_loss": 0.28416189551353455,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 27579.0,
      "epoch": 0.039119122839620886,
      "grad_norm": 0.6951005458831787,
      "learning_rate": 9.909393083033723e-06,
      "loss": 0.133,
      "mae_dtheta": 0.03286612406373024,
      "mae_dx": 0.010266688652336597,
      "mae_dy": 0.004201721400022507,
      "pose_mae_dtheta": 0.2575736343860626,
      "pose_mae_dx": 0.07865490019321442,
      "pose_mae_dy": 0.06191634759306908,
      "pose_rmse_dtheta": 0.4798666834831238,
      "pose_rmse_dx": 0.17777179181575775,
      "pose_rmse_dy": 0.14221900701522827,
      "pose_rmse_mean": 0.26661917567253113,
      "rmse_dtheta": 0.05177626758813858,
      "rmse_dx": 0.02254621312022209,
      "rmse_dy": 0.007839511148631573,
      "rmse_mean": 0.027387328445911407,
      "rotation_flip": 0.01316872425377369,
      "sparse_tokens": 22989.0,
      "step": 842,
      "turn_loss": 0.2009536772966385,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.03916558260546367,
      "grad_norm": 0.6461159586906433,
      "learning_rate": 9.909142336437417e-06,
      "loss": 0.1359,
      "mae_dtheta": 0.011611808091402054,
      "mae_dx": 0.002487476682290435,
      "mae_dy": 0.0027701181825250387,
      "pose_mae_dtheta": 0.08065687119960785,
      "pose_mae_dx": 0.03128396347165108,
      "pose_mae_dy": 0.03956605866551399,
      "pose_rmse_dtheta": 0.15771456062793732,
      "pose_rmse_dx": 0.06887322664260864,
      "pose_rmse_dy": 0.09745699912309647,
      "pose_rmse_mean": 0.10801493376493454,
      "rmse_dtheta": 0.02253134176135063,
      "rmse_dx": 0.006958509795367718,
      "rmse_dy": 0.005826222710311413,
      "rmse_mean": 0.011772025376558304,
      "rotation_flip": 0.0050161234103143215,
      "sparse_tokens": 32169.0,
      "step": 843,
      "turn_loss": 0.11883477121591568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.039212042371306446,
      "grad_norm": 0.7471968531608582,
      "learning_rate": 9.908891246542154e-06,
      "loss": 0.1702,
      "mae_dtheta": 0.013501654379069805,
      "mae_dx": 0.0030435516964644194,
      "mae_dy": 0.002686565276235342,
      "pose_mae_dtheta": 0.09981123358011246,
      "pose_mae_dx": 0.04041674733161926,
      "pose_mae_dy": 0.03607137128710747,
      "pose_rmse_dtheta": 0.26352164149284363,
      "pose_rmse_dx": 0.09364433586597443,
      "pose_rmse_dy": 0.08336110413074493,
      "pose_rmse_mean": 0.146842360496521,
      "rmse_dtheta": 0.029836812987923622,
      "rmse_dx": 0.008907996118068695,
      "rmse_dy": 0.0057106236927211285,
      "rmse_mean": 0.01481847744435072,
      "rotation_flip": 0.008677897043526173,
      "sparse_tokens": 32057.0,
      "step": 844,
      "turn_loss": 0.1318953037261963,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10375.0,
      "epoch": 0.03925850213714923,
      "grad_norm": 0.9610898494720459,
      "learning_rate": 9.90863981336549e-06,
      "loss": 0.3041,
      "mae_dtheta": 0.02690683677792549,
      "mae_dx": 0.006818156689405441,
      "mae_dy": 0.007511192001402378,
      "pose_mae_dtheta": 0.193581685423851,
      "pose_mae_dx": 0.06539873033761978,
      "pose_mae_dy": 0.10064660757780075,
      "pose_rmse_dtheta": 0.3156338334083557,
      "pose_rmse_dx": 0.1528877317905426,
      "pose_rmse_dy": 0.1789301335811615,
      "pose_rmse_mean": 0.21581724286079407,
      "rmse_dtheta": 0.039674073457717896,
      "rmse_dx": 0.016631217673420906,
      "rmse_dy": 0.012414583005011082,
      "rmse_mean": 0.022906623780727386,
      "rotation_flip": 0.025581395253539085,
      "sparse_tokens": 8631.0,
      "step": 845,
      "turn_loss": 0.2688998878002167,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.03930496190299201,
      "grad_norm": 0.5580077767372131,
      "learning_rate": 9.908388036925011e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.008668402209877968,
      "mae_dx": 0.0021149995736777782,
      "mae_dy": 0.002280992455780506,
      "pose_mae_dtheta": 0.060803741216659546,
      "pose_mae_dx": 0.02583671174943447,
      "pose_mae_dy": 0.02330501191318035,
      "pose_rmse_dtheta": 0.12069250643253326,
      "pose_rmse_dx": 0.059683483093976974,
      "pose_rmse_dy": 0.05385787412524223,
      "pose_rmse_mean": 0.07807795703411102,
      "rmse_dtheta": 0.018421530723571777,
      "rmse_dx": 0.005704490002244711,
      "rmse_dy": 0.005263384897261858,
      "rmse_mean": 0.009796468541026115,
      "rotation_flip": 0.0037792895454913378,
      "sparse_tokens": 32169.0,
      "step": 846,
      "turn_loss": 0.08266422152519226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.03935142166883479,
      "grad_norm": 0.5823554992675781,
      "learning_rate": 9.908135917238321e-06,
      "loss": 0.1577,
      "mae_dtheta": 0.008996576070785522,
      "mae_dx": 0.002085645217448473,
      "mae_dy": 0.0018187735695391893,
      "pose_mae_dtheta": 0.07151509821414948,
      "pose_mae_dx": 0.022809188812971115,
      "pose_mae_dy": 0.0258686114102602,
      "pose_rmse_dtheta": 0.20140966773033142,
      "pose_rmse_dx": 0.07222938537597656,
      "pose_rmse_dy": 0.06750821322202682,
      "pose_rmse_mean": 0.113715760409832,
      "rmse_dtheta": 0.021819138899445534,
      "rmse_dx": 0.006671086419373751,
      "rmse_dy": 0.004422344733029604,
      "rmse_mean": 0.010970856994390488,
      "rotation_flip": 0.004828797187656164,
      "sparse_tokens": 32121.0,
      "step": 847,
      "turn_loss": 0.07060910016298294,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.03939788143467757,
      "grad_norm": 0.6076731085777283,
      "learning_rate": 9.907883454323052e-06,
      "loss": 0.1225,
      "mae_dtheta": 0.011253301985561848,
      "mae_dx": 0.0024251788854599,
      "mae_dy": 0.0025988908018916845,
      "pose_mae_dtheta": 0.08395311236381531,
      "pose_mae_dx": 0.027793701738119125,
      "pose_mae_dy": 0.03266545757651329,
      "pose_rmse_dtheta": 0.21660931408405304,
      "pose_rmse_dx": 0.08247331529855728,
      "pose_rmse_dy": 0.10331690311431885,
      "pose_rmse_mean": 0.13413318991661072,
      "rmse_dtheta": 0.024422984570264816,
      "rmse_dx": 0.007724781986325979,
      "rmse_dy": 0.006172357127070427,
      "rmse_mean": 0.012773375026881695,
      "rotation_flip": 0.006323396693915129,
      "sparse_tokens": 32073.0,
      "step": 848,
      "turn_loss": 0.07691459357738495,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.03944434120052035,
      "grad_norm": 0.40544599294662476,
      "learning_rate": 9.907630648196857e-06,
      "loss": 0.0859,
      "mae_dtheta": 0.036697473376989365,
      "mae_dx": 0.009467359632253647,
      "mae_dy": 0.005322628188878298,
      "pose_mae_dtheta": 0.3018593192100525,
      "pose_mae_dx": 0.07832048088312149,
      "pose_mae_dy": 0.06398025155067444,
      "pose_rmse_dtheta": 0.5156766772270203,
      "pose_rmse_dx": 0.17728595435619354,
      "pose_rmse_dy": 0.14915992319583893,
      "pose_rmse_mean": 0.28070753812789917,
      "rmse_dtheta": 0.05415894463658333,
      "rmse_dx": 0.019297024235129356,
      "rmse_dy": 0.012286584824323654,
      "rmse_mean": 0.02858084999024868,
      "rotation_flip": 0.011904762126505375,
      "sparse_tokens": 5926.0,
      "step": 849,
      "turn_loss": 0.3739420771598816,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.03949080096636313,
      "grad_norm": 0.6071484088897705,
      "learning_rate": 9.90737749887742e-06,
      "loss": 0.1627,
      "mae_dtheta": 0.038626447319984436,
      "mae_dx": 0.008082563057541847,
      "mae_dy": 0.006917331833392382,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6071483492851257,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 145.79415893554688,
      "model/head/act_norm_mean": 104.58477492559524,
      "model/head/act_norm_min": 73.84819793701172,
      "model/head/act_over_embed": 71.87163646695848,
      "model/head/grad_frac": 0.12128809839487076,
      "model/head/grad_norm": 0.0736398696899414,
      "model/head/grad_zero_frac": 0.00016593313193880022,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6744326636904762,
      "model/head/update_ratio": 0.0012857188703492284,
      "model/head/weight_delta": 3.2161755561828613,
      "model/head/weight_delta_rel": 0.056421246379613876,
      "model/head/weight_norm": 57.27524948120117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41132909059524536,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41129710457541724,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.411242812871933,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28264722088838734,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05973603576421738,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03626863658428192,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5355113636363636,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011824558023363352,
      "model/modality_embedder.encoders.pose/weight_delta": 0.9762884378433228,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.031898386776447296,
      "model/modality_embedder.encoders.pose/weight_norm": 30.672298431396484,
      "model/modality_embedder/grad_frac": 0.05973603576421738,
      "model/modality_embedder/grad_norm": 0.03626863658428192,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5355113636363636,
      "model/modality_embedder/update_ratio": 0.0011824558023363352,
      "model/modality_embedder/weight_delta": 0.9762884378433228,
      "model/modality_embedder/weight_delta_rel": 0.031898386776447296,
      "model/modality_embedder/weight_norm": 30.672298431396484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 69.98582458496094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.83717462679516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.96263313293457,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.693920208531043,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1350887268781662,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0820188969373703,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002981877652928233,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.4921746551990509,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.017935141921043396,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.505788803100586,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 71.52346801757812,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.80146476993575,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.644111633300781,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.356589422723815,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09710507094860077,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05895718187093735,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002033758908510208,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.5900881886482239,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.020441116765141487,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.989267349243164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 73.20568084716797,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.588730631141345,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.173236846923828,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.584815255190918,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10253433138132095,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.062253549695014954,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002081293612718582,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.61372971534729,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.02060789428651333,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.91098976135254,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.44140625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.61602418745276,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.540627479553223,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.977990366909427,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.15774929523468018,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.095777228474617,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0032628036569803953,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.5195850133895874,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.017756950110197067,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.354272842407227,
      "model/normalizer/grad_frac": 0.6449894905090332,
      "model/normalizer/grad_norm": 0.39160430431365967,
      "model/normalizer/grad_zero_frac": 0.0001571712055010721,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.005034855101257563,
      "model/normalizer/weight_delta": 1.1416889429092407,
      "model/normalizer/weight_delta_rel": 0.014704292640089989,
      "model/normalizer/weight_norm": 77.7786636352539,
      "pose_mae_dtheta": 0.30447250604629517,
      "pose_mae_dx": 0.06247486174106598,
      "pose_mae_dy": 0.053027477115392685,
      "pose_rmse_dtheta": 0.5257622599601746,
      "pose_rmse_dx": 0.15484367311000824,
      "pose_rmse_dy": 0.10849245637655258,
      "pose_rmse_mean": 0.26303279399871826,
      "rmse_dtheta": 0.05571814998984337,
      "rmse_dx": 0.018810030072927475,
      "rmse_dy": 0.013076454401016235,
      "rmse_mean": 0.02920154482126236,
      "rotation_flip": 0.0060606058686971664,
      "sparse_tokens": 5635.0,
      "step": 850,
      "turn_loss": 0.22552502155303955,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.03953726073220591,
      "grad_norm": 0.3598003089427948,
      "learning_rate": 9.907124006382438e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.007911819033324718,
      "mae_dx": 0.0016449418617412448,
      "mae_dy": 0.0018702277448028326,
      "pose_mae_dtheta": 0.05494415760040283,
      "pose_mae_dx": 0.017581060528755188,
      "pose_mae_dy": 0.01890191063284874,
      "pose_rmse_dtheta": 0.1336073875427246,
      "pose_rmse_dx": 0.041636496782302856,
      "pose_rmse_dy": 0.05275145545601845,
      "pose_rmse_mean": 0.0759984478354454,
      "rmse_dtheta": 0.018703294917941093,
      "rmse_dx": 0.004590525757521391,
      "rmse_dy": 0.0057363747619092464,
      "rmse_mean": 0.009676732122898102,
      "rotation_flip": 0.00471327593550086,
      "sparse_tokens": 32169.0,
      "step": 851,
      "turn_loss": 0.07307860255241394,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.03958372049804869,
      "grad_norm": 0.5301130414009094,
      "learning_rate": 9.906870170729643e-06,
      "loss": 0.1208,
      "mae_dtheta": 0.0398113913834095,
      "mae_dx": 0.011773671954870224,
      "mae_dy": 0.003844652557745576,
      "pose_mae_dtheta": 0.3156634271144867,
      "pose_mae_dx": 0.09393385797739029,
      "pose_mae_dy": 0.050914838910102844,
      "pose_rmse_dtheta": 0.5602359175682068,
      "pose_rmse_dx": 0.18236251175403595,
      "pose_rmse_dy": 0.1135048121213913,
      "pose_rmse_mean": 0.2853677570819855,
      "rmse_dtheta": 0.057572510093450546,
      "rmse_dx": 0.023167626932263374,
      "rmse_dy": 0.007038230542093515,
      "rmse_mean": 0.0292594563215971,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 8414.0,
      "step": 852,
      "turn_loss": 0.26470595598220825,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.03963018026389147,
      "grad_norm": 0.49337393045425415,
      "learning_rate": 9.906615991936781e-06,
      "loss": 0.1113,
      "mae_dtheta": 0.009735972620546818,
      "mae_dx": 0.001996217994019389,
      "mae_dy": 0.003007389372214675,
      "pose_mae_dtheta": 0.0722641721367836,
      "pose_mae_dx": 0.026809362694621086,
      "pose_mae_dy": 0.03126461058855057,
      "pose_rmse_dtheta": 0.20825901627540588,
      "pose_rmse_dx": 0.06727737188339233,
      "pose_rmse_dy": 0.07272233814001083,
      "pose_rmse_mean": 0.11608624458312988,
      "rmse_dtheta": 0.022758128121495247,
      "rmse_dx": 0.0051551153883337975,
      "rmse_dy": 0.006776376627385616,
      "rmse_mean": 0.011563207022845745,
      "rotation_flip": 0.003757632803171873,
      "sparse_tokens": 32073.0,
      "step": 853,
      "turn_loss": 0.09027255326509476,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.03967664002973425,
      "grad_norm": 0.37047278881073,
      "learning_rate": 9.90636147002163e-06,
      "loss": 0.0664,
      "mae_dtheta": 0.008970010094344616,
      "mae_dx": 0.002090379362925887,
      "mae_dy": 0.0012315113563090563,
      "pose_mae_dtheta": 0.07157643884420395,
      "pose_mae_dx": 0.02153114601969719,
      "pose_mae_dy": 0.01725444756448269,
      "pose_rmse_dtheta": 0.2598347067832947,
      "pose_rmse_dx": 0.07004937529563904,
      "pose_rmse_dy": 0.060480546206235886,
      "pose_rmse_mean": 0.13012154400348663,
      "rmse_dtheta": 0.028383838012814522,
      "rmse_dx": 0.007190477102994919,
      "rmse_dy": 0.004588735289871693,
      "rmse_mean": 0.013387683779001236,
      "rotation_flip": 0.004702194128185511,
      "sparse_tokens": 32105.0,
      "step": 854,
      "turn_loss": 0.0518210232257843,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.03972309979557703,
      "grad_norm": 0.48434978723526,
      "learning_rate": 9.906106605001988e-06,
      "loss": 0.1283,
      "mae_dtheta": 0.009497145190834999,
      "mae_dx": 0.001940536662004888,
      "mae_dy": 0.001481584389694035,
      "pose_mae_dtheta": 0.07289256155490875,
      "pose_mae_dx": 0.019076036289334297,
      "pose_mae_dy": 0.017639609053730965,
      "pose_rmse_dtheta": 0.2359042465686798,
      "pose_rmse_dx": 0.04204927384853363,
      "pose_rmse_dy": 0.04754539579153061,
      "pose_rmse_mean": 0.10849963873624802,
      "rmse_dtheta": 0.026221737265586853,
      "rmse_dx": 0.005054866895079613,
      "rmse_dy": 0.003783632768318057,
      "rmse_mean": 0.011686746031045914,
      "rotation_flip": 0.0013550135772675276,
      "sparse_tokens": 32169.0,
      "step": 855,
      "turn_loss": 0.07989119738340378,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.03976955956141981,
      "grad_norm": 0.7715170979499817,
      "learning_rate": 9.905851396895679e-06,
      "loss": 0.1354,
      "mae_dtheta": 0.013540475629270077,
      "mae_dx": 0.002577289007604122,
      "mae_dy": 0.0031236133072525263,
      "pose_mae_dtheta": 0.08886739611625671,
      "pose_mae_dx": 0.036050960421562195,
      "pose_mae_dy": 0.04062832146883011,
      "pose_rmse_dtheta": 0.20069487392902374,
      "pose_rmse_dx": 0.07733270525932312,
      "pose_rmse_dy": 0.08753250539302826,
      "pose_rmse_mean": 0.12185337394475937,
      "rmse_dtheta": 0.025685997679829597,
      "rmse_dx": 0.006587073672562838,
      "rmse_dy": 0.005818825215101242,
      "rmse_mean": 0.01269729994237423,
      "rotation_flip": 0.0032185388263314962,
      "sparse_tokens": 32137.0,
      "step": 856,
      "turn_loss": 0.10914897173643112,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.03981601932726259,
      "grad_norm": 0.4509006440639496,
      "learning_rate": 9.905595845720546e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.04036174342036247,
      "mae_dx": 0.015442135743796825,
      "mae_dy": 0.007021439727395773,
      "pose_mae_dtheta": 0.36812278628349304,
      "pose_mae_dx": 0.13826721906661987,
      "pose_mae_dy": 0.07968363910913467,
      "pose_rmse_dtheta": 0.5576174259185791,
      "pose_rmse_dx": 0.29611557722091675,
      "pose_rmse_dy": 0.15951420366764069,
      "pose_rmse_mean": 0.33774909377098083,
      "rmse_dtheta": 0.058118436485528946,
      "rmse_dx": 0.02931860461831093,
      "rmse_dy": 0.011587504297494888,
      "rmse_mean": 0.033008184283971786,
      "rotation_flip": 0.010256410576403141,
      "sparse_tokens": 6560.0,
      "step": 857,
      "turn_loss": 0.32505279779434204,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.03986247909310537,
      "grad_norm": 0.5315834283828735,
      "learning_rate": 9.905339951494464e-06,
      "loss": 0.1368,
      "mae_dtheta": 0.013827821239829063,
      "mae_dx": 0.0030201554764062166,
      "mae_dy": 0.003993688616901636,
      "pose_mae_dtheta": 0.10317790508270264,
      "pose_mae_dx": 0.041687000542879105,
      "pose_mae_dy": 0.04640108719468117,
      "pose_rmse_dtheta": 0.22364826500415802,
      "pose_rmse_dx": 0.0964936837553978,
      "pose_rmse_dy": 0.10966747254133224,
      "pose_rmse_mean": 0.14326980710029602,
      "rmse_dtheta": 0.026073725894093513,
      "rmse_dx": 0.007797215133905411,
      "rmse_dy": 0.009147151373326778,
      "rmse_mean": 0.014339365065097809,
      "rotation_flip": 0.0010940919164568186,
      "sparse_tokens": 32089.0,
      "step": 858,
      "turn_loss": 0.1278751641511917,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.039908938858948154,
      "grad_norm": 1.1187565326690674,
      "learning_rate": 9.905083714235326e-06,
      "loss": 0.2733,
      "mae_dtheta": 0.031113583594560623,
      "mae_dx": 0.012594453059136868,
      "mae_dy": 0.004291169811040163,
      "pose_mae_dtheta": 0.2559814453125,
      "pose_mae_dx": 0.1148315817117691,
      "pose_mae_dy": 0.047561388462781906,
      "pose_rmse_dtheta": 0.43700432777404785,
      "pose_rmse_dx": 0.22785118222236633,
      "pose_rmse_dy": 0.1078801304101944,
      "pose_rmse_mean": 0.2575785517692566,
      "rmse_dtheta": 0.047711726278066635,
      "rmse_dx": 0.023557143285870552,
      "rmse_dy": 0.008473297581076622,
      "rmse_mean": 0.026580724865198135,
      "rotation_flip": 0.01154734380543232,
      "sparse_tokens": 7621.0,
      "step": 859,
      "turn_loss": 0.301521360874176,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 30170.0,
      "epoch": 0.03995539862479093,
      "grad_norm": 0.8816114664077759,
      "learning_rate": 9.904827133961052e-06,
      "loss": 0.271,
      "mae_dtheta": 0.026540499180555344,
      "mae_dx": 0.008144746534526348,
      "mae_dy": 0.0032009552232921124,
      "pose_mae_dtheta": 0.2104572355747223,
      "pose_mae_dx": 0.05480750650167465,
      "pose_mae_dy": 0.03437133505940437,
      "pose_rmse_dtheta": 0.40831422805786133,
      "pose_rmse_dx": 0.14512702822685242,
      "pose_rmse_dy": 0.08662281185388565,
      "pose_rmse_mean": 0.2133547067642212,
      "rmse_dtheta": 0.04537009447813034,
      "rmse_dx": 0.018830029293894768,
      "rmse_dy": 0.008167341351509094,
      "rmse_mean": 0.024122489616274834,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 24652.0,
      "step": 860,
      "turn_loss": 0.19085179269313812,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.040001858390633714,
      "grad_norm": 0.5945056676864624,
      "learning_rate": 9.904570210689584e-06,
      "loss": 0.1502,
      "mae_dtheta": 0.013627906329929829,
      "mae_dx": 0.003101898590102792,
      "mae_dy": 0.0033843230921775103,
      "pose_mae_dtheta": 0.092476025223732,
      "pose_mae_dx": 0.04076886922121048,
      "pose_mae_dy": 0.04186098650097847,
      "pose_rmse_dtheta": 0.1855107694864273,
      "pose_rmse_dx": 0.08566387742757797,
      "pose_rmse_dy": 0.09041362255811691,
      "pose_rmse_mean": 0.1205294281244278,
      "rmse_dtheta": 0.025324514135718346,
      "rmse_dx": 0.007473845034837723,
      "rmse_dy": 0.00654623145237565,
      "rmse_mean": 0.013114864006638527,
      "rotation_flip": 0.004336223937571049,
      "sparse_tokens": 32169.0,
      "step": 861,
      "turn_loss": 0.12853708863258362,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04004831815647649,
      "grad_norm": 0.458626389503479,
      "learning_rate": 9.904312944438887e-06,
      "loss": 0.1444,
      "mae_dtheta": 0.01450483687222004,
      "mae_dx": 0.005676380358636379,
      "mae_dy": 0.005389112513512373,
      "pose_mae_dtheta": 0.1110968291759491,
      "pose_mae_dx": 0.05972421541810036,
      "pose_mae_dy": 0.06289248913526535,
      "pose_rmse_dtheta": 0.255810409784317,
      "pose_rmse_dx": 0.17647311091423035,
      "pose_rmse_dy": 0.19685927033424377,
      "pose_rmse_mean": 0.20971426367759705,
      "rmse_dtheta": 0.029850514605641365,
      "rmse_dx": 0.01898910664021969,
      "rmse_dy": 0.01489462424069643,
      "rmse_mean": 0.021244749426841736,
      "rotation_flip": 0.006510915234684944,
      "sparse_tokens": 32089.0,
      "step": 862,
      "turn_loss": 0.20222613215446472,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.040094777922319275,
      "grad_norm": 0.6580089926719666,
      "learning_rate": 9.904055335226954e-06,
      "loss": 0.1798,
      "mae_dtheta": 0.03843959793448448,
      "mae_dx": 0.009560894221067429,
      "mae_dy": 0.006761894561350346,
      "pose_mae_dtheta": 0.26474741101264954,
      "pose_mae_dx": 0.07899095863103867,
      "pose_mae_dy": 0.06955836713314056,
      "pose_rmse_dtheta": 0.48599615693092346,
      "pose_rmse_dx": 0.18052460253238678,
      "pose_rmse_dy": 0.13941103219985962,
      "pose_rmse_mean": 0.26864394545555115,
      "rmse_dtheta": 0.05802973359823227,
      "rmse_dx": 0.02096140757203102,
      "rmse_dy": 0.013409016653895378,
      "rmse_mean": 0.03080005571246147,
      "rotation_flip": 0.01823154091835022,
      "sparse_tokens": 19451.0,
      "step": 863,
      "turn_loss": 0.3220990300178528,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.04014123768816205,
      "grad_norm": 0.637283980846405,
      "learning_rate": 9.9037973830718e-06,
      "loss": 0.1882,
      "mae_dtheta": 0.03592101112008095,
      "mae_dx": 0.011643057689070702,
      "mae_dy": 0.005779800936579704,
      "pose_mae_dtheta": 0.27073127031326294,
      "pose_mae_dx": 0.10299244523048401,
      "pose_mae_dy": 0.08683861047029495,
      "pose_rmse_dtheta": 0.4672900140285492,
      "pose_rmse_dx": 0.23246853053569794,
      "pose_rmse_dy": 0.17691564559936523,
      "pose_rmse_mean": 0.2922247350215912,
      "rmse_dtheta": 0.054485101252794266,
      "rmse_dx": 0.02497226558625698,
      "rmse_dy": 0.011762944050133228,
      "rmse_mean": 0.0304067712277174,
      "rotation_flip": 0.011782032437622547,
      "sparse_tokens": 11301.0,
      "step": 864,
      "turn_loss": 0.2961743474006653,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.040187697454004835,
      "grad_norm": 0.61147141456604,
      "learning_rate": 9.903539087991462e-06,
      "loss": 0.1707,
      "mae_dtheta": 0.014777296222746372,
      "mae_dx": 0.002771040890365839,
      "mae_dy": 0.003557280171662569,
      "pose_mae_dtheta": 0.08940568566322327,
      "pose_mae_dx": 0.0333251953125,
      "pose_mae_dy": 0.04265996441245079,
      "pose_rmse_dtheta": 0.17889489233493805,
      "pose_rmse_dx": 0.06814847141504288,
      "pose_rmse_dy": 0.09539903700351715,
      "pose_rmse_mean": 0.11414746940135956,
      "rmse_dtheta": 0.02638998068869114,
      "rmse_dx": 0.006824807729572058,
      "rmse_dy": 0.0065117389895021915,
      "rmse_mean": 0.013242176733911037,
      "rotation_flip": 0.010728218592703342,
      "sparse_tokens": 32137.0,
      "step": 865,
      "turn_loss": 0.15394647419452667,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.04023415721984761,
      "grad_norm": 0.6290695667266846,
      "learning_rate": 9.903280450004004e-06,
      "loss": 0.165,
      "mae_dtheta": 0.048445943742990494,
      "mae_dx": 0.014096648432314396,
      "mae_dy": 0.007397033274173737,
      "pose_mae_dtheta": 0.3837912678718567,
      "pose_mae_dx": 0.11928485333919525,
      "pose_mae_dy": 0.08252386003732681,
      "pose_rmse_dtheta": 0.6335259675979614,
      "pose_rmse_dx": 0.2432679533958435,
      "pose_rmse_dy": 0.22698703408241272,
      "pose_rmse_mean": 0.36792701482772827,
      "rmse_dtheta": 0.06850318610668182,
      "rmse_dx": 0.026314109563827515,
      "rmse_dy": 0.017518943175673485,
      "rmse_mean": 0.03744541481137276,
      "rotation_flip": 0.014392991550266743,
      "sparse_tokens": 23658.0,
      "step": 866,
      "turn_loss": 0.4232099950313568,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.04028061698569039,
      "grad_norm": 0.4717440903186798,
      "learning_rate": 9.903021469127515e-06,
      "loss": 0.1379,
      "mae_dtheta": 0.013110305182635784,
      "mae_dx": 0.0031598471105098724,
      "mae_dy": 0.004021818283945322,
      "pose_mae_dtheta": 0.0944453701376915,
      "pose_mae_dx": 0.03639422357082367,
      "pose_mae_dy": 0.045080896466970444,
      "pose_rmse_dtheta": 0.21512427926063538,
      "pose_rmse_dx": 0.10326194763183594,
      "pose_rmse_dy": 0.12844780087471008,
      "pose_rmse_mean": 0.1489446759223938,
      "rmse_dtheta": 0.02736539952456951,
      "rmse_dx": 0.009663894772529602,
      "rmse_dy": 0.009450150653719902,
      "rmse_mean": 0.015493149869143963,
      "rotation_flip": 0.010145566426217556,
      "sparse_tokens": 32073.0,
      "step": 867,
      "turn_loss": 0.11258050054311752,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.04032707675153317,
      "grad_norm": 0.4305446445941925,
      "learning_rate": 9.9027621453801e-06,
      "loss": 0.0832,
      "mae_dtheta": 0.026393862441182137,
      "mae_dx": 0.011937913484871387,
      "mae_dy": 0.005308583378791809,
      "pose_mae_dtheta": 0.16844479739665985,
      "pose_mae_dx": 0.07674778997898102,
      "pose_mae_dy": 0.07641574740409851,
      "pose_rmse_dtheta": 0.29814860224723816,
      "pose_rmse_dx": 0.19835714995861053,
      "pose_rmse_dy": 0.1845521330833435,
      "pose_rmse_mean": 0.2270192950963974,
      "rmse_dtheta": 0.04164800047874451,
      "rmse_dx": 0.026040662080049515,
      "rmse_dy": 0.010420355014503002,
      "rmse_mean": 0.026036337018013,
      "rotation_flip": 0.02678571455180645,
      "sparse_tokens": 8365.0,
      "step": 868,
      "turn_loss": 0.2322172224521637,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.04037353651737595,
      "grad_norm": 0.5845654010772705,
      "learning_rate": 9.902502478779897e-06,
      "loss": 0.1426,
      "mae_dtheta": 0.012169135734438896,
      "mae_dx": 0.002840462140738964,
      "mae_dy": 0.0032059792429208755,
      "pose_mae_dtheta": 0.0869215875864029,
      "pose_mae_dx": 0.03248879685997963,
      "pose_mae_dy": 0.03495941311120987,
      "pose_rmse_dtheta": 0.20657102763652802,
      "pose_rmse_dx": 0.09380729496479034,
      "pose_rmse_dy": 0.08407113701105118,
      "pose_rmse_mean": 0.1281498223543167,
      "rmse_dtheta": 0.025855468586087227,
      "rmse_dx": 0.009924807585775852,
      "rmse_dy": 0.008886106312274933,
      "rmse_mean": 0.014888795092701912,
      "rotation_flip": 0.0034980324562639,
      "sparse_tokens": 32073.0,
      "step": 869,
      "turn_loss": 0.11623520404100418,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.04041999628321873,
      "grad_norm": 0.6741076111793518,
      "learning_rate": 9.902242469345064e-06,
      "loss": 0.1856,
      "mae_dtheta": 0.04364816099405289,
      "mae_dx": 0.020282529294490814,
      "mae_dy": 0.0068053812719881535,
      "pose_mae_dtheta": 0.3657820522785187,
      "pose_mae_dx": 0.16504770517349243,
      "pose_mae_dy": 0.0892956554889679,
      "pose_rmse_dtheta": 0.5224476456642151,
      "pose_rmse_dx": 0.33324939012527466,
      "pose_rmse_dy": 0.2021535485982895,
      "pose_rmse_mean": 0.3526168763637543,
      "rmse_dtheta": 0.05991572141647339,
      "rmse_dx": 0.03371219336986542,
      "rmse_dy": 0.013804446905851364,
      "rmse_mean": 0.035810790956020355,
      "rotation_flip": 0.018099548295140266,
      "sparse_tokens": 3871.0,
      "step": 870,
      "turn_loss": 0.26390939950942993,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04046645604906151,
      "grad_norm": 0.6480193734169006,
      "learning_rate": 9.901982117093786e-06,
      "loss": 0.1903,
      "mae_dtheta": 0.012139209546148777,
      "mae_dx": 0.0027068457566201687,
      "mae_dy": 0.0031677999068051577,
      "pose_mae_dtheta": 0.08358565717935562,
      "pose_mae_dx": 0.030193299055099487,
      "pose_mae_dy": 0.04133560135960579,
      "pose_rmse_dtheta": 0.20296218991279602,
      "pose_rmse_dx": 0.09240435063838959,
      "pose_rmse_dy": 0.13143330812454224,
      "pose_rmse_mean": 0.14226661622524261,
      "rmse_dtheta": 0.02473319321870804,
      "rmse_dx": 0.008529857732355595,
      "rmse_dy": 0.009926076047122478,
      "rmse_mean": 0.014396375976502895,
      "rotation_flip": 0.007127882447093725,
      "sparse_tokens": 32089.0,
      "step": 871,
      "turn_loss": 0.12215220928192139,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04051291581490429,
      "grad_norm": 0.547340452671051,
      "learning_rate": 9.901721422044266e-06,
      "loss": 0.1348,
      "mae_dtheta": 0.010911487974226475,
      "mae_dx": 0.002677837386727333,
      "mae_dy": 0.0025473851710557938,
      "pose_mae_dtheta": 0.07866434752941132,
      "pose_mae_dx": 0.03273408114910126,
      "pose_mae_dy": 0.033226046711206436,
      "pose_rmse_dtheta": 0.17134889960289001,
      "pose_rmse_dx": 0.08835343271493912,
      "pose_rmse_dy": 0.08044992387294769,
      "pose_rmse_mean": 0.11338409036397934,
      "rmse_dtheta": 0.021954042837023735,
      "rmse_dx": 0.007589621935039759,
      "rmse_dy": 0.0058752684853971004,
      "rmse_mean": 0.011806311085820198,
      "rotation_flip": 0.0036930651403963566,
      "sparse_tokens": 32089.0,
      "step": 872,
      "turn_loss": 0.08538222312927246,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22719.0,
      "epoch": 0.04055937558074707,
      "grad_norm": 0.606886625289917,
      "learning_rate": 9.901460384214737e-06,
      "loss": 0.1446,
      "mae_dtheta": 0.04319170117378235,
      "mae_dx": 0.014476049691438675,
      "mae_dy": 0.005997950676828623,
      "pose_mae_dtheta": 0.3476235270500183,
      "pose_mae_dx": 0.12781928479671478,
      "pose_mae_dy": 0.053182270377874374,
      "pose_rmse_dtheta": 0.5865544676780701,
      "pose_rmse_dx": 0.26070544123649597,
      "pose_rmse_dy": 0.11918379366397858,
      "pose_rmse_mean": 0.3221479058265686,
      "rmse_dtheta": 0.06264067441225052,
      "rmse_dx": 0.0266574677079916,
      "rmse_dy": 0.013213285245001316,
      "rmse_mean": 0.0341704785823822,
      "rotation_flip": 0.014828545041382313,
      "sparse_tokens": 19231.0,
      "step": 873,
      "turn_loss": 0.33906272053718567,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 9760.0,
      "epoch": 0.040605835346589854,
      "grad_norm": 0.46211305260658264,
      "learning_rate": 9.901199003623451e-06,
      "loss": 0.1171,
      "mae_dtheta": 0.029271338135004044,
      "mae_dx": 0.010147915221750736,
      "mae_dy": 0.006838261149823666,
      "pose_mae_dtheta": 0.20787128806114197,
      "pose_mae_dx": 0.0815688744187355,
      "pose_mae_dy": 0.08164320141077042,
      "pose_rmse_dtheta": 0.374595046043396,
      "pose_rmse_dx": 0.18003225326538086,
      "pose_rmse_dy": 0.20690037310123444,
      "pose_rmse_mean": 0.2538425624370575,
      "rmse_dtheta": 0.04707591235637665,
      "rmse_dx": 0.0210424792021513,
      "rmse_dy": 0.013701413758099079,
      "rmse_mean": 0.0272732712328434,
      "rotation_flip": 0.016701461747288704,
      "sparse_tokens": 7531.0,
      "step": 874,
      "turn_loss": 0.20880913734436035,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.04065229511243263,
      "grad_norm": 1.2766032218933105,
      "learning_rate": 9.90093728028869e-06,
      "loss": 0.2433,
      "mae_dtheta": 0.02235480770468712,
      "mae_dx": 0.01453334093093872,
      "mae_dy": 0.004952188115566969,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999991655349731,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 141.0851287841797,
      "model/head/act_norm_mean": 108.86784532335069,
      "model/head/act_norm_min": 84.361083984375,
      "model/head/act_over_embed": 74.81500254303285,
      "model/head/grad_frac": 0.10849260538816452,
      "model/head/grad_norm": 0.10849251598119736,
      "model/head/grad_zero_frac": 0.00015927042113617063,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6748046875,
      "model/head/update_ratio": 0.0018939328147098422,
      "model/head/weight_delta": 3.2722890377044678,
      "model/head/weight_delta_rel": 0.05740564316511154,
      "model/head/weight_norm": 57.28424835205078,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4113231599330902,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4112807273864746,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.411264032125473,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2826359663308203,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06264998018741608,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0626499280333519,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5373046875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002042402047663927,
      "model/modality_embedder.encoders.pose/weight_delta": 0.9901747703552246,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.03235209733247757,
      "model/modality_embedder.encoders.pose/weight_norm": 30.67462921142578,
      "model/modality_embedder/grad_frac": 0.06264998018741608,
      "model/modality_embedder/grad_norm": 0.0626499280333519,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5373046875,
      "model/modality_embedder/update_ratio": 0.002042402047663927,
      "model/modality_embedder/weight_delta": 0.9901747703552246,
      "model/modality_embedder/weight_delta_rel": 0.03235209733247757,
      "model/modality_embedder/weight_norm": 30.67462921142578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.11499786376953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.18096030368166,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.862811088562012,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.930172944259661,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10377466678619385,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.10377457737922668,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.003772537922486663,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.5045962333679199,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.018387790769338608,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.50789451599121,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.1314468383789,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.082224151234566,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.738849639892578,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.5495298980631,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10621289908885956,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.1062128096818924,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0036633634008467197,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.6072182655334473,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.021034514531493187,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.993249893188477,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.96017456054688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.790783110119047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.469843864440918,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.723667610389505,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.12500803172588348,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.12500792741775513,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.004178691189736128,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.63227778673172,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.021230705082416534,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.915571212768555,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.87861633300781,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.774422674162256,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.031347274780273,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.08684328992619,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12716799974441528,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.12716789543628693,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.004331705626100302,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.5360623598098755,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.01832006685435772,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.357463836669922,
      "model/normalizer/grad_frac": 0.48903486132621765,
      "model/normalizer/grad_norm": 0.4890344440937042,
      "model/normalizer/grad_zero_frac": 0.00017253380792681128,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.006287132855504751,
      "model/normalizer/weight_delta": 1.1750930547714233,
      "model/normalizer/weight_delta_rel": 0.015134518034756184,
      "model/normalizer/weight_norm": 77.78337860107422,
      "pose_mae_dtheta": 0.13496173918247223,
      "pose_mae_dx": 0.11814328283071518,
      "pose_mae_dy": 0.06520646065473557,
      "pose_rmse_dtheta": 0.237427219748497,
      "pose_rmse_dx": 0.2574804127216339,
      "pose_rmse_dy": 0.11085385084152222,
      "pose_rmse_mean": 0.2019204944372177,
      "rmse_dtheta": 0.03396819159388542,
      "rmse_dx": 0.028645876795053482,
      "rmse_dy": 0.007657818030565977,
      "rmse_mean": 0.02342396229505539,
      "rotation_flip": 0.0,
      "sparse_tokens": 2370.0,
      "step": 875,
      "turn_loss": 0.19354993104934692,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 30400.0,
      "epoch": 0.040698754878275414,
      "grad_norm": 0.5798486471176147,
      "learning_rate": 9.900675214228752e-06,
      "loss": 0.1985,
      "mae_dtheta": 0.04098456725478172,
      "mae_dx": 0.01331388857215643,
      "mae_dy": 0.005491454154253006,
      "pose_mae_dtheta": 0.322488397359848,
      "pose_mae_dx": 0.10419751703739166,
      "pose_mae_dy": 0.06506546586751938,
      "pose_rmse_dtheta": 0.5226519107818604,
      "pose_rmse_dx": 0.2262222319841385,
      "pose_rmse_dy": 0.13766174018383026,
      "pose_rmse_mean": 0.29551196098327637,
      "rmse_dtheta": 0.05718330666422844,
      "rmse_dx": 0.025571465492248535,
      "rmse_dy": 0.009937970899045467,
      "rmse_mean": 0.030897583812475204,
      "rotation_flip": 0.016702977940440178,
      "sparse_tokens": 23498.0,
      "step": 876,
      "turn_loss": 0.3180786073207855,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.04074521464411819,
      "grad_norm": 0.7171860337257385,
      "learning_rate": 9.900412805461968e-06,
      "loss": 0.1519,
      "mae_dtheta": 0.006489391904324293,
      "mae_dx": 0.0016743538435548544,
      "mae_dy": 0.000494286126922816,
      "pose_mae_dtheta": 0.04499746859073639,
      "pose_mae_dx": 0.013555672951042652,
      "pose_mae_dy": 0.006346296984702349,
      "pose_rmse_dtheta": 0.17687347531318665,
      "pose_rmse_dx": 0.02870088815689087,
      "pose_rmse_dy": 0.018490076065063477,
      "pose_rmse_mean": 0.0746881514787674,
      "rmse_dtheta": 0.023397691547870636,
      "rmse_dx": 0.0042660851031541824,
      "rmse_dy": 0.001334742410108447,
      "rmse_mean": 0.009666172787547112,
      "rotation_flip": 0.0030196276493370533,
      "sparse_tokens": 32233.0,
      "step": 877,
      "turn_loss": 0.05472439154982567,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5530.0,
      "epoch": 0.040791674409960975,
      "grad_norm": 0.6760472655296326,
      "learning_rate": 9.900150054006686e-06,
      "loss": 0.101,
      "mae_dtheta": 0.03620411828160286,
      "mae_dx": 0.012880238704383373,
      "mae_dy": 0.013288087211549282,
      "pose_mae_dtheta": 0.28028300404548645,
      "pose_mae_dx": 0.12877622246742249,
      "pose_mae_dy": 0.10932892560958862,
      "pose_rmse_dtheta": 0.4756307005882263,
      "pose_rmse_dx": 0.277365118265152,
      "pose_rmse_dy": 0.2432538866996765,
      "pose_rmse_mean": 0.33208325505256653,
      "rmse_dtheta": 0.05531438812613487,
      "rmse_dx": 0.024122029542922974,
      "rmse_dy": 0.027110222727060318,
      "rmse_mean": 0.035515546798706055,
      "rotation_flip": 0.0139860138297081,
      "sparse_tokens": 4954.0,
      "step": 878,
      "turn_loss": 0.4487558901309967,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.04083813417580375,
      "grad_norm": 0.4981708526611328,
      "learning_rate": 9.89988695988128e-06,
      "loss": 0.1215,
      "mae_dtheta": 0.011690215207636356,
      "mae_dx": 0.0026167624164372683,
      "mae_dy": 0.0026800348423421383,
      "pose_mae_dtheta": 0.0819210633635521,
      "pose_mae_dx": 0.029625510796904564,
      "pose_mae_dy": 0.034722473472356796,
      "pose_rmse_dtheta": 0.17506688833236694,
      "pose_rmse_dx": 0.07020719349384308,
      "pose_rmse_dy": 0.08145859092473984,
      "pose_rmse_mean": 0.10891088843345642,
      "rmse_dtheta": 0.023193860426545143,
      "rmse_dx": 0.007272788323462009,
      "rmse_dy": 0.006106134504079819,
      "rmse_mean": 0.012190928682684898,
      "rotation_flip": 0.0038340885657817125,
      "sparse_tokens": 32169.0,
      "step": 879,
      "turn_loss": 0.10594673454761505,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.040884593941646535,
      "grad_norm": 0.779867947101593,
      "learning_rate": 9.899623523104149e-06,
      "loss": 0.1486,
      "mae_dtheta": 0.00822440069168806,
      "mae_dx": 0.0017941883997991681,
      "mae_dy": 0.0012745207641273737,
      "pose_mae_dtheta": 0.06628070771694183,
      "pose_mae_dx": 0.01721007749438286,
      "pose_mae_dy": 0.018099075183272362,
      "pose_rmse_dtheta": 0.23368103802204132,
      "pose_rmse_dx": 0.043732255697250366,
      "pose_rmse_dy": 0.05561251565814018,
      "pose_rmse_mean": 0.11100860685110092,
      "rmse_dtheta": 0.024193594232201576,
      "rmse_dx": 0.005155746825039387,
      "rmse_dy": 0.003198286984115839,
      "rmse_mean": 0.010849210433661938,
      "rotation_flip": 0.004739336669445038,
      "sparse_tokens": 32169.0,
      "step": 880,
      "turn_loss": 0.05524428188800812,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.04093105370748931,
      "grad_norm": 1.017749309539795,
      "learning_rate": 9.899359743693715e-06,
      "loss": 0.2635,
      "mae_dtheta": 0.02792692929506302,
      "mae_dx": 0.014248822815716267,
      "mae_dy": 0.005072754807770252,
      "pose_mae_dtheta": 0.241059809923172,
      "pose_mae_dx": 0.126979261636734,
      "pose_mae_dy": 0.09205559641122818,
      "pose_rmse_dtheta": 0.4006606638431549,
      "pose_rmse_dx": 0.2673267126083374,
      "pose_rmse_dy": 0.1842622011899948,
      "pose_rmse_mean": 0.28408318758010864,
      "rmse_dtheta": 0.042409662157297134,
      "rmse_dx": 0.028380872681736946,
      "rmse_dy": 0.009527910500764847,
      "rmse_mean": 0.026772817596793175,
      "rotation_flip": 0.007225433364510536,
      "sparse_tokens": 12254.0,
      "step": 881,
      "turn_loss": 0.23515987396240234,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.040977513473332096,
      "grad_norm": 0.619797945022583,
      "learning_rate": 9.899095621668425e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.013040722347795963,
      "mae_dx": 0.00435932632535696,
      "mae_dy": 0.004924043081700802,
      "pose_mae_dtheta": 0.10208834707736969,
      "pose_mae_dx": 0.0456915982067585,
      "pose_mae_dy": 0.05268087983131409,
      "pose_rmse_dtheta": 0.21211567521095276,
      "pose_rmse_dx": 0.13268625736236572,
      "pose_rmse_dy": 0.1242397353053093,
      "pose_rmse_mean": 0.15634723007678986,
      "rmse_dtheta": 0.02533014304935932,
      "rmse_dx": 0.011958563700318336,
      "rmse_dy": 0.010257634334266186,
      "rmse_mean": 0.015848781913518906,
      "rotation_flip": 0.0028901733458042145,
      "sparse_tokens": 32089.0,
      "step": 882,
      "turn_loss": 0.1466575264930725,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04102397323917487,
      "grad_norm": 0.4945511519908905,
      "learning_rate": 9.898831157046748e-06,
      "loss": 0.1603,
      "mae_dtheta": 0.015561752021312714,
      "mae_dx": 0.0036680412013083696,
      "mae_dy": 0.004174023400992155,
      "pose_mae_dtheta": 0.10507752746343613,
      "pose_mae_dx": 0.039621345698833466,
      "pose_mae_dy": 0.04566648229956627,
      "pose_rmse_dtheta": 0.21015700697898865,
      "pose_rmse_dx": 0.10122144967317581,
      "pose_rmse_dy": 0.09721273928880692,
      "pose_rmse_mean": 0.1361970603466034,
      "rmse_dtheta": 0.02841191180050373,
      "rmse_dx": 0.011273495852947235,
      "rmse_dy": 0.00924097653478384,
      "rmse_mean": 0.016308795660734177,
      "rotation_flip": 0.006592643912881613,
      "sparse_tokens": 32089.0,
      "step": 883,
      "turn_loss": 0.15311771631240845,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.041070433005017656,
      "grad_norm": 0.5413815975189209,
      "learning_rate": 9.898566349847181e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.012106014415621758,
      "mae_dx": 0.0034729542676359415,
      "mae_dy": 0.002951736794784665,
      "pose_mae_dtheta": 0.09482334554195404,
      "pose_mae_dx": 0.03019452467560768,
      "pose_mae_dy": 0.02049899846315384,
      "pose_rmse_dtheta": 0.28137072920799255,
      "pose_rmse_dx": 0.09441037476062775,
      "pose_rmse_dy": 0.09043048322200775,
      "pose_rmse_mean": 0.15540388226509094,
      "rmse_dtheta": 0.03310948237776756,
      "rmse_dx": 0.010061616078019142,
      "rmse_dy": 0.011075709015130997,
      "rmse_mean": 0.018082270398736,
      "rotation_flip": 0.005467468407005072,
      "sparse_tokens": 32185.0,
      "step": 884,
      "turn_loss": 0.14604240655899048,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.04111689277086043,
      "grad_norm": 0.6388403177261353,
      "learning_rate": 9.898301200088238e-06,
      "loss": 0.1701,
      "mae_dtheta": 0.0316886343061924,
      "mae_dx": 0.01270788349211216,
      "mae_dy": 0.004676384851336479,
      "pose_mae_dtheta": 0.25884705781936646,
      "pose_mae_dx": 0.10963813215494156,
      "pose_mae_dy": 0.04907809570431709,
      "pose_rmse_dtheta": 0.44196364283561707,
      "pose_rmse_dx": 0.22538521885871887,
      "pose_rmse_dy": 0.11765476316213608,
      "pose_rmse_mean": 0.2616678774356842,
      "rmse_dtheta": 0.04712226241827011,
      "rmse_dx": 0.024823307991027832,
      "rmse_dy": 0.008519603870809078,
      "rmse_mean": 0.026821725070476532,
      "rotation_flip": 0.017119839787483215,
      "sparse_tokens": 17224.0,
      "step": 885,
      "turn_loss": 0.23104576766490936,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.04116335253670322,
      "grad_norm": 0.5633153915405273,
      "learning_rate": 9.898035707788462e-06,
      "loss": 0.0816,
      "mae_dtheta": 0.013368391431868076,
      "mae_dx": 0.0017261356115341187,
      "mae_dy": 0.002349168760702014,
      "pose_mae_dtheta": 0.09268027544021606,
      "pose_mae_dx": 0.024386350065469742,
      "pose_mae_dy": 0.030877597630023956,
      "pose_rmse_dtheta": 0.24661241471767426,
      "pose_rmse_dx": 0.059696685522794724,
      "pose_rmse_dy": 0.07446479797363281,
      "pose_rmse_mean": 0.12692463397979736,
      "rmse_dtheta": 0.03068607486784458,
      "rmse_dx": 0.005055438261479139,
      "rmse_dy": 0.004944045562297106,
      "rmse_mean": 0.013561852276325226,
      "rotation_flip": 0.009152407757937908,
      "sparse_tokens": 32105.0,
      "step": 886,
      "turn_loss": 0.08870039880275726,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.041209812302545994,
      "grad_norm": 0.6034805774688721,
      "learning_rate": 9.897769872966423e-06,
      "loss": 0.1143,
      "mae_dtheta": 0.009731949307024479,
      "mae_dx": 0.002131939632818103,
      "mae_dy": 0.0020727107767015696,
      "pose_mae_dtheta": 0.06772355735301971,
      "pose_mae_dx": 0.022207487374544144,
      "pose_mae_dy": 0.030280685052275658,
      "pose_rmse_dtheta": 0.14655077457427979,
      "pose_rmse_dx": 0.05725910887122154,
      "pose_rmse_dy": 0.0670933946967125,
      "pose_rmse_mean": 0.09030109643936157,
      "rmse_dtheta": 0.019962534308433533,
      "rmse_dx": 0.006908921524882317,
      "rmse_dy": 0.004642586223781109,
      "rmse_mean": 0.010504680685698986,
      "rotation_flip": 0.003955696243792772,
      "sparse_tokens": 32121.0,
      "step": 887,
      "turn_loss": 0.07869860529899597,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.04125627206838878,
      "grad_norm": 0.7019928693771362,
      "learning_rate": 9.897503695640705e-06,
      "loss": 0.1271,
      "mae_dtheta": 0.031784869730472565,
      "mae_dx": 0.012606974691152573,
      "mae_dy": 0.005566487554460764,
      "pose_mae_dtheta": 0.2546798288822174,
      "pose_mae_dx": 0.10961708426475525,
      "pose_mae_dy": 0.09040677547454834,
      "pose_rmse_dtheta": 0.43682098388671875,
      "pose_rmse_dx": 0.23912139236927032,
      "pose_rmse_dy": 0.19697198271751404,
      "pose_rmse_mean": 0.29097145795822144,
      "rmse_dtheta": 0.047566235065460205,
      "rmse_dx": 0.026008475571870804,
      "rmse_dy": 0.00937658827751875,
      "rmse_mean": 0.02765043079853058,
      "rotation_flip": 0.010781670920550823,
      "sparse_tokens": 7193.0,
      "step": 888,
      "turn_loss": 0.21651022136211395,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.041302731834231554,
      "grad_norm": 0.6840856671333313,
      "learning_rate": 9.897237175829927e-06,
      "loss": 0.1565,
      "mae_dtheta": 0.013688218779861927,
      "mae_dx": 0.0032443141099065542,
      "mae_dy": 0.003024169011041522,
      "pose_mae_dtheta": 0.09619945287704468,
      "pose_mae_dx": 0.033890288323163986,
      "pose_mae_dy": 0.0320727713406086,
      "pose_rmse_dtheta": 0.23512862622737885,
      "pose_rmse_dx": 0.07671484351158142,
      "pose_rmse_dy": 0.0786137580871582,
      "pose_rmse_mean": 0.1301524043083191,
      "rmse_dtheta": 0.029305921867489815,
      "rmse_dx": 0.009126808494329453,
      "rmse_dy": 0.007594561669975519,
      "rmse_mean": 0.01534243207424879,
      "rotation_flip": 0.006123919505625963,
      "sparse_tokens": 32169.0,
      "step": 889,
      "turn_loss": 0.1386026293039322,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.04134919160007434,
      "grad_norm": 0.4688466191291809,
      "learning_rate": 9.896970313552723e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.04801251366734505,
      "mae_dx": 0.012193804606795311,
      "mae_dy": 0.004061106126755476,
      "pose_mae_dtheta": 0.3838605284690857,
      "pose_mae_dx": 0.09689324349164963,
      "pose_mae_dy": 0.046047091484069824,
      "pose_rmse_dtheta": 0.6174033284187317,
      "pose_rmse_dx": 0.2060471773147583,
      "pose_rmse_dy": 0.12859326601028442,
      "pose_rmse_mean": 0.3173479437828064,
      "rmse_dtheta": 0.06595692783594131,
      "rmse_dx": 0.02308052033185959,
      "rmse_dy": 0.009086305275559425,
      "rmse_mean": 0.03270791843533516,
      "rotation_flip": 0.0227544903755188,
      "sparse_tokens": 12495.0,
      "step": 890,
      "turn_loss": 0.32407015562057495,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.041395651365917115,
      "grad_norm": 0.8678513765335083,
      "learning_rate": 9.896703108827758e-06,
      "loss": 0.1212,
      "mae_dtheta": 0.01594640128314495,
      "mae_dx": 0.0026582437567412853,
      "mae_dy": 0.0028205218259245157,
      "pose_mae_dtheta": 0.1088683158159256,
      "pose_mae_dx": 0.027700500562787056,
      "pose_mae_dy": 0.03842176869511604,
      "pose_rmse_dtheta": 0.23773211240768433,
      "pose_rmse_dx": 0.0668380931019783,
      "pose_rmse_dy": 0.08604148775339127,
      "pose_rmse_mean": 0.13020390272140503,
      "rmse_dtheta": 0.03108600340783596,
      "rmse_dx": 0.008088644593954086,
      "rmse_dy": 0.006246848497539759,
      "rmse_mean": 0.015140498988330364,
      "rotation_flip": 0.00943767186254263,
      "sparse_tokens": 32121.0,
      "step": 891,
      "turn_loss": 0.13136345148086548,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.0414421111317599,
      "grad_norm": 0.6927818059921265,
      "learning_rate": 9.896435561673717e-06,
      "loss": 0.1614,
      "mae_dtheta": 0.0557350218296051,
      "mae_dx": 0.013842913322150707,
      "mae_dy": 0.011963670141994953,
      "pose_mae_dtheta": 0.414804071187973,
      "pose_mae_dx": 0.121514692902565,
      "pose_mae_dy": 0.11990773677825928,
      "pose_rmse_dtheta": 0.6517505645751953,
      "pose_rmse_dx": 0.3030731976032257,
      "pose_rmse_dy": 0.3213212192058563,
      "pose_rmse_mean": 0.4253816604614258,
      "rmse_dtheta": 0.07117561995983124,
      "rmse_dx": 0.025206342339515686,
      "rmse_dy": 0.027433138340711594,
      "rmse_mean": 0.04127170145511627,
      "rotation_flip": 0.009646302089095116,
      "sparse_tokens": 5385.0,
      "step": 892,
      "turn_loss": 0.5307496786117554,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.041488570897602675,
      "grad_norm": 0.5227250456809998,
      "learning_rate": 9.896167672109307e-06,
      "loss": 0.1521,
      "mae_dtheta": 0.03265325725078583,
      "mae_dx": 0.011135661974549294,
      "mae_dy": 0.004628677386790514,
      "pose_mae_dtheta": 0.2614749073982239,
      "pose_mae_dx": 0.09512579441070557,
      "pose_mae_dy": 0.05481334030628204,
      "pose_rmse_dtheta": 0.48336806893348694,
      "pose_rmse_dx": 0.2097439467906952,
      "pose_rmse_dy": 0.14197956025600433,
      "pose_rmse_mean": 0.2783638834953308,
      "rmse_dtheta": 0.05148598551750183,
      "rmse_dx": 0.0231050755828619,
      "rmse_dy": 0.009448648430407047,
      "rmse_mean": 0.028013236820697784,
      "rotation_flip": 0.018691588193178177,
      "sparse_tokens": 24692.0,
      "step": 893,
      "turn_loss": 0.2669731676578522,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.04153503066344546,
      "grad_norm": 0.3451921045780182,
      "learning_rate": 9.895899440153265e-06,
      "loss": 0.13,
      "mae_dtheta": 0.010675843805074692,
      "mae_dx": 0.0024239153135567904,
      "mae_dy": 0.0020437813363969326,
      "pose_mae_dtheta": 0.07799136638641357,
      "pose_mae_dx": 0.03219032287597656,
      "pose_mae_dy": 0.030521560460329056,
      "pose_rmse_dtheta": 0.17516785860061646,
      "pose_rmse_dx": 0.09411151707172394,
      "pose_rmse_dy": 0.07700806111097336,
      "pose_rmse_mean": 0.11542914807796478,
      "rmse_dtheta": 0.023041915148496628,
      "rmse_dx": 0.00795934721827507,
      "rmse_dy": 0.004984812345355749,
      "rmse_mean": 0.011995358392596245,
      "rotation_flip": 0.004144218750298023,
      "sparse_tokens": 32137.0,
      "step": 894,
      "turn_loss": 0.0915074571967125,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.041581490429288236,
      "grad_norm": 0.3756120502948761,
      "learning_rate": 9.895630865824347e-06,
      "loss": 0.0791,
      "mae_dtheta": 0.02316954918205738,
      "mae_dx": 0.008516043424606323,
      "mae_dy": 0.0027530004736036062,
      "pose_mae_dtheta": 0.13888701796531677,
      "pose_mae_dx": 0.05872518569231033,
      "pose_mae_dy": 0.052358053624629974,
      "pose_rmse_dtheta": 0.2324420064687729,
      "pose_rmse_dx": 0.17550764977931976,
      "pose_rmse_dy": 0.1641741842031479,
      "pose_rmse_mean": 0.1907079517841339,
      "rmse_dtheta": 0.038998011499643326,
      "rmse_dx": 0.021382564678788185,
      "rmse_dy": 0.006235210224986076,
      "rmse_mean": 0.022205263376235962,
      "rotation_flip": 0.01984127052128315,
      "sparse_tokens": 4354.0,
      "step": 895,
      "turn_loss": 0.10391013324260712,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.04162795019513102,
      "grad_norm": 0.5278137922286987,
      "learning_rate": 9.895361949141336e-06,
      "loss": 0.1625,
      "mae_dtheta": 0.03227197378873825,
      "mae_dx": 0.019851941615343094,
      "mae_dy": 0.0043120235204696655,
      "pose_mae_dtheta": 0.23110824823379517,
      "pose_mae_dx": 0.17302317917346954,
      "pose_mae_dy": 0.06438647955656052,
      "pose_rmse_dtheta": 0.3825453221797943,
      "pose_rmse_dx": 0.3404003381729126,
      "pose_rmse_dy": 0.13376690447330475,
      "pose_rmse_mean": 0.2855708599090576,
      "rmse_dtheta": 0.04659750312566757,
      "rmse_dx": 0.034426383674144745,
      "rmse_dy": 0.007200086023658514,
      "rmse_mean": 0.029407991096377373,
      "rotation_flip": 0.014084506779909134,
      "sparse_tokens": 8347.0,
      "step": 896,
      "turn_loss": 0.27926793694496155,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 31369.0,
      "epoch": 0.041674409960973796,
      "grad_norm": 0.49610596895217896,
      "learning_rate": 9.895092690123036e-06,
      "loss": 0.1437,
      "mae_dtheta": 0.03147675842046738,
      "mae_dx": 0.013428350910544395,
      "mae_dy": 0.005479337647557259,
      "pose_mae_dtheta": 0.2576623857021332,
      "pose_mae_dx": 0.11223233491182327,
      "pose_mae_dy": 0.07853828370571136,
      "pose_rmse_dtheta": 0.4333215355873108,
      "pose_rmse_dx": 0.23614080250263214,
      "pose_rmse_dy": 0.2023467868566513,
      "pose_rmse_mean": 0.29060304164886475,
      "rmse_dtheta": 0.04806783050298691,
      "rmse_dx": 0.026449674740433693,
      "rmse_dy": 0.011708511039614677,
      "rmse_mean": 0.028742006048560143,
      "rotation_flip": 0.013731825165450573,
      "sparse_tokens": 26080.0,
      "step": 897,
      "turn_loss": 0.2682589292526245,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.04172086972681658,
      "grad_norm": 0.9043878316879272,
      "learning_rate": 9.894823088788274e-06,
      "loss": 0.1919,
      "mae_dtheta": 0.038893137127161026,
      "mae_dx": 0.009029680863022804,
      "mae_dy": 0.006025864742696285,
      "pose_mae_dtheta": 0.2680509090423584,
      "pose_mae_dx": 0.054107483476400375,
      "pose_mae_dy": 0.04103376716375351,
      "pose_rmse_dtheta": 0.49957290291786194,
      "pose_rmse_dx": 0.11680785566568375,
      "pose_rmse_dy": 0.09113433957099915,
      "pose_rmse_mean": 0.235838383436203,
      "rmse_dtheta": 0.0616251602768898,
      "rmse_dx": 0.019119933247566223,
      "rmse_dy": 0.013372501358389854,
      "rmse_mean": 0.03137253224849701,
      "rotation_flip": 0.012658228166401386,
      "sparse_tokens": 3364.0,
      "step": 898,
      "turn_loss": 0.3430481255054474,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.04176732949265936,
      "grad_norm": 0.4141726791858673,
      "learning_rate": 9.894553145155909e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.007907827384769917,
      "mae_dx": 0.0018636584281921387,
      "mae_dy": 0.0007549602305516601,
      "pose_mae_dtheta": 0.0539972297847271,
      "pose_mae_dx": 0.01646294817328453,
      "pose_mae_dy": 0.010751541703939438,
      "pose_rmse_dtheta": 0.19084393978118896,
      "pose_rmse_dx": 0.052361149340867996,
      "pose_rmse_dy": 0.029417872428894043,
      "pose_rmse_mean": 0.0908743143081665,
      "rmse_dtheta": 0.025228627026081085,
      "rmse_dx": 0.005816671531647444,
      "rmse_dy": 0.0019269280601292849,
      "rmse_mean": 0.010990742594003677,
      "rotation_flip": 0.003489183494821191,
      "sparse_tokens": 32137.0,
      "step": 899,
      "turn_loss": 0.06296908855438232,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.04181378925850214,
      "grad_norm": 0.7228572964668274,
      "learning_rate": 9.894282859244816e-06,
      "loss": 0.1641,
      "mae_dtheta": 0.012541195377707481,
      "mae_dx": 0.0024662672076374292,
      "mae_dy": 0.002992697060108185,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7228571176528931,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.58407592773438,
      "model/head/act_norm_mean": 104.09706439393939,
      "model/head/act_norm_min": 72.66549682617188,
      "model/head/act_over_embed": 71.53647722358664,
      "model/head/grad_frac": 0.08686880022287369,
      "model/head/grad_norm": 0.06279373168945312,
      "model/head/grad_zero_frac": 0.00019290123600512743,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6870659722222222,
      "model/head/update_ratio": 0.0010960121871903539,
      "model/head/weight_delta": 3.322136640548706,
      "model/head/weight_delta_rel": 0.05828011780977249,
      "model/head/weight_norm": 57.29291534423828,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41133975982666016,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4112671179705501,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41118910908699036,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28262661381278364,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0960390567779541,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06942251324653625,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5325100806451613,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0022630575112998486,
      "model/modality_embedder.encoders.pose/weight_delta": 1.0132677555084229,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.03310661390423775,
      "model/modality_embedder.encoders.pose/weight_norm": 30.67642593383789,
      "model/modality_embedder/grad_frac": 0.0960390567779541,
      "model/modality_embedder/grad_norm": 0.06942251324653625,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5325100806451613,
      "model/modality_embedder/update_ratio": 0.0022630575112998486,
      "model/modality_embedder/weight_delta": 1.0132677555084229,
      "model/modality_embedder/weight_delta_rel": 0.03310661390423775,
      "model/modality_embedder/weight_norm": 30.67642593383789,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.87415313720703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.74932860349527,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.9422607421875,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.633551598891932,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.054504819214344025,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.039399195462465286,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014321671333163977,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.5160960555076599,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.018806852400302887,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.51019287109375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.12723541259766,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.831003487253486,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.272684097290039,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.37688870581039,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.058314770460128784,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0421532467007637,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014537243405357003,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.6212607622146606,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.021520959213376045,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 28.99672508239746,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.68428039550781,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.82580266955267,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.676788330078125,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.747733379490573,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06336116045713425,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0458010658621788,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015308172442018986,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.6482301354408264,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.021766353398561478,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.919355392456055,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 80.36451721191406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.746858465608465,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.406149864196777,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.067900907747838,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0662902221083641,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04791835695505142,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016320357099175453,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.5500130653381348,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.018796836957335472,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.361095428466797,
      "model/normalizer/grad_frac": 0.2158091515302658,
      "model/normalizer/grad_norm": 0.15599918365478516,
      "model/normalizer/grad_zero_frac": 0.00020562247664202005,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002005449729040265,
      "model/normalizer/weight_delta": 1.2035945653915405,
      "model/normalizer/weight_delta_rel": 0.015501600690186024,
      "model/normalizer/weight_norm": 77.78762817382812,
      "pose_mae_dtheta": 0.08593448996543884,
      "pose_mae_dx": 0.03356773778796196,
      "pose_mae_dy": 0.04281901940703392,
      "pose_rmse_dtheta": 0.17481686174869537,
      "pose_rmse_dx": 0.09394751489162445,
      "pose_rmse_dy": 0.09042331576347351,
      "pose_rmse_mean": 0.11972923576831818,
      "rmse_dtheta": 0.023780247196555138,
      "rmse_dx": 0.00852563139051199,
      "rmse_dy": 0.005704977549612522,
      "rmse_mean": 0.012670285068452358,
      "rotation_flip": 0.0034338037949055433,
      "sparse_tokens": 32057.0,
      "step": 900,
      "turn_loss": 0.10686486959457397,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.04186024902434492,
      "grad_norm": 0.5932793617248535,
      "learning_rate": 9.894012231073895e-06,
      "loss": 0.1236,
      "mae_dtheta": 0.012981412932276726,
      "mae_dx": 0.0028912436682730913,
      "mae_dy": 0.002827751450240612,
      "pose_mae_dtheta": 0.09013932943344116,
      "pose_mae_dx": 0.029812978580594063,
      "pose_mae_dy": 0.03235727176070213,
      "pose_rmse_dtheta": 0.20040519535541534,
      "pose_rmse_dx": 0.07115287333726883,
      "pose_rmse_dy": 0.07671870291233063,
      "pose_rmse_mean": 0.1160922646522522,
      "rmse_dtheta": 0.02649322710931301,
      "rmse_dx": 0.00815869402140379,
      "rmse_dy": 0.005619349889457226,
      "rmse_mean": 0.013423757627606392,
      "rotation_flip": 0.003709810320287943,
      "sparse_tokens": 32137.0,
      "step": 901,
      "turn_loss": 0.1126919537782669,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.0419067087901877,
      "grad_norm": 0.6815553307533264,
      "learning_rate": 9.89374126066207e-06,
      "loss": 0.1129,
      "mae_dtheta": 0.03800123929977417,
      "mae_dx": 0.015843858942389488,
      "mae_dy": 0.008407440036535263,
      "pose_mae_dtheta": 0.2679832875728607,
      "pose_mae_dx": 0.14078481495380402,
      "pose_mae_dy": 0.11795417219400406,
      "pose_rmse_dtheta": 0.41418346762657166,
      "pose_rmse_dx": 0.26172664761543274,
      "pose_rmse_dy": 0.21251191198825836,
      "pose_rmse_mean": 0.2961406707763672,
      "rmse_dtheta": 0.05350397527217865,
      "rmse_dx": 0.029228847473859787,
      "rmse_dy": 0.013271494768559933,
      "rmse_mean": 0.03200144320726395,
      "rotation_flip": 0.016949152573943138,
      "sparse_tokens": 15110.0,
      "step": 902,
      "turn_loss": 0.38740962743759155,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.04195316855603048,
      "grad_norm": 0.7078455090522766,
      "learning_rate": 9.893469948028295e-06,
      "loss": 0.1936,
      "mae_dtheta": 0.014474263414740562,
      "mae_dx": 0.003219547914341092,
      "mae_dy": 0.003550434485077858,
      "pose_mae_dtheta": 0.10687335580587387,
      "pose_mae_dx": 0.04112586751580238,
      "pose_mae_dy": 0.041175536811351776,
      "pose_rmse_dtheta": 0.2277706414461136,
      "pose_rmse_dx": 0.11983519047498703,
      "pose_rmse_dy": 0.08421143144369125,
      "pose_rmse_mean": 0.1439390927553177,
      "rmse_dtheta": 0.02715383470058441,
      "rmse_dx": 0.00987054593861103,
      "rmse_dy": 0.007671312894672155,
      "rmse_mean": 0.014898563735187054,
      "rotation_flip": 0.0061085158959031105,
      "sparse_tokens": 32073.0,
      "step": 903,
      "turn_loss": 0.14203572273254395,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32114.0,
      "epoch": 0.041999628321873254,
      "grad_norm": 0.5636811852455139,
      "learning_rate": 9.893198293191539e-06,
      "loss": 0.1439,
      "mae_dtheta": 0.037739481776952744,
      "mae_dx": 0.011282292194664478,
      "mae_dy": 0.004491536878049374,
      "pose_mae_dtheta": 0.29184481501579285,
      "pose_mae_dx": 0.1038646399974823,
      "pose_mae_dy": 0.047592636197805405,
      "pose_rmse_dtheta": 0.5034007430076599,
      "pose_rmse_dx": 0.23580573499202728,
      "pose_rmse_dy": 0.10997786372900009,
      "pose_rmse_mean": 0.2830614447593689,
      "rmse_dtheta": 0.05568661540746689,
      "rmse_dx": 0.023783419281244278,
      "rmse_dy": 0.009810579009354115,
      "rmse_mean": 0.0297602079808712,
      "rotation_flip": 0.013140604831278324,
      "sparse_tokens": 23529.0,
      "step": 904,
      "turn_loss": 0.3523625135421753,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.04204608808771604,
      "grad_norm": 0.49077776074409485,
      "learning_rate": 9.8929262961708e-06,
      "loss": 0.0994,
      "mae_dtheta": 0.010931367054581642,
      "mae_dx": 0.0022249091416597366,
      "mae_dy": 0.001999162370339036,
      "pose_mae_dtheta": 0.08988190442323685,
      "pose_mae_dx": 0.015435547567903996,
      "pose_mae_dy": 0.019993523135781288,
      "pose_rmse_dtheta": 0.28549355268478394,
      "pose_rmse_dx": 0.0503954142332077,
      "pose_rmse_dy": 0.05445455014705658,
      "pose_rmse_mean": 0.13011452555656433,
      "rmse_dtheta": 0.03049500286579132,
      "rmse_dx": 0.007793257012963295,
      "rmse_dy": 0.007445781026035547,
      "rmse_mean": 0.01524468045681715,
      "rotation_flip": 0.004315659869462252,
      "sparse_tokens": 32057.0,
      "step": 905,
      "turn_loss": 0.08005400747060776,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.042092547853558815,
      "grad_norm": 0.3902605175971985,
      "learning_rate": 9.892653956985097e-06,
      "loss": 0.1037,
      "mae_dtheta": 0.011683524586260319,
      "mae_dx": 0.002628331771120429,
      "mae_dy": 0.0035784852225333452,
      "pose_mae_dtheta": 0.08401268720626831,
      "pose_mae_dx": 0.027241749688982964,
      "pose_mae_dy": 0.02947959490120411,
      "pose_rmse_dtheta": 0.19462716579437256,
      "pose_rmse_dx": 0.07345351576805115,
      "pose_rmse_dy": 0.06804700195789337,
      "pose_rmse_mean": 0.11204256862401962,
      "rmse_dtheta": 0.024822646751999855,
      "rmse_dx": 0.008364437147974968,
      "rmse_dy": 0.00906183198094368,
      "rmse_mean": 0.014082971960306168,
      "rotation_flip": 0.006663705222308636,
      "sparse_tokens": 32041.0,
      "step": 906,
      "turn_loss": 0.11958532780408859,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.0421390076194016,
      "grad_norm": 0.6342149972915649,
      "learning_rate": 9.89238127565348e-06,
      "loss": 0.2043,
      "mae_dtheta": 0.03595442697405815,
      "mae_dx": 0.013455312699079514,
      "mae_dy": 0.007429235149174929,
      "pose_mae_dtheta": 0.28255799412727356,
      "pose_mae_dx": 0.09292256087064743,
      "pose_mae_dy": 0.09166240692138672,
      "pose_rmse_dtheta": 0.4524410665035248,
      "pose_rmse_dx": 0.18976646661758423,
      "pose_rmse_dy": 0.2049410194158554,
      "pose_rmse_mean": 0.2823828458786011,
      "rmse_dtheta": 0.05226333439350128,
      "rmse_dx": 0.02640928141772747,
      "rmse_dy": 0.013841086998581886,
      "rmse_mean": 0.030837900936603546,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 10964.0,
      "step": 907,
      "turn_loss": 0.32997310161590576,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.042185467385244375,
      "grad_norm": 0.5264168977737427,
      "learning_rate": 9.892108252195012e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.00969348382204771,
      "mae_dx": 0.0029632679652422667,
      "mae_dy": 0.002217578701674938,
      "pose_mae_dtheta": 0.07269058376550674,
      "pose_mae_dx": 0.02862967550754547,
      "pose_mae_dy": 0.02683601900935173,
      "pose_rmse_dtheta": 0.20570088922977448,
      "pose_rmse_dx": 0.08886028081178665,
      "pose_rmse_dy": 0.06913363933563232,
      "pose_rmse_mean": 0.12123160809278488,
      "rmse_dtheta": 0.024313297122716904,
      "rmse_dx": 0.009882582351565361,
      "rmse_dy": 0.006926714908331633,
      "rmse_mean": 0.013707531616091728,
      "rotation_flip": 0.0028409091755747795,
      "sparse_tokens": 32057.0,
      "step": 908,
      "turn_loss": 0.0863763764500618,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.04223192715108716,
      "grad_norm": 0.4236375689506531,
      "learning_rate": 9.891834886628789e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.014039376750588417,
      "mae_dx": 0.0029293012339621782,
      "mae_dy": 0.0032407434191554785,
      "pose_mae_dtheta": 0.1041623204946518,
      "pose_mae_dx": 0.03338150680065155,
      "pose_mae_dy": 0.03643839433789253,
      "pose_rmse_dtheta": 0.2591615319252014,
      "pose_rmse_dx": 0.09010107815265656,
      "pose_rmse_dy": 0.09909790754318237,
      "pose_rmse_mean": 0.14945350587368011,
      "rmse_dtheta": 0.029316691681742668,
      "rmse_dx": 0.008366178721189499,
      "rmse_dy": 0.008436917327344418,
      "rmse_mean": 0.015373262576758862,
      "rotation_flip": 0.0060836500488221645,
      "sparse_tokens": 32121.0,
      "step": 909,
      "turn_loss": 0.11742385476827621,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.042278386916929936,
      "grad_norm": 0.9092267155647278,
      "learning_rate": 9.891561178973927e-06,
      "loss": 0.1448,
      "mae_dtheta": 0.01079352106899023,
      "mae_dx": 0.001836162875406444,
      "mae_dy": 0.00219723186455667,
      "pose_mae_dtheta": 0.07766513526439667,
      "pose_mae_dx": 0.024514202028512955,
      "pose_mae_dy": 0.027074819430708885,
      "pose_rmse_dtheta": 0.20988832414150238,
      "pose_rmse_dx": 0.06219818443059921,
      "pose_rmse_dy": 0.0630103126168251,
      "pose_rmse_mean": 0.1116989403963089,
      "rmse_dtheta": 0.024762572720646858,
      "rmse_dx": 0.005673875100910664,
      "rmse_dy": 0.004450894892215729,
      "rmse_mean": 0.011629114858806133,
      "rotation_flip": 0.0033783784601837397,
      "sparse_tokens": 32073.0,
      "step": 910,
      "turn_loss": 0.08072883635759354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.04232484668277272,
      "grad_norm": 0.6365192532539368,
      "learning_rate": 9.891287129249565e-06,
      "loss": 0.2125,
      "mae_dtheta": 0.03255033865571022,
      "mae_dx": 0.007878219708800316,
      "mae_dy": 0.004326829221099615,
      "pose_mae_dtheta": 0.2598860263824463,
      "pose_mae_dx": 0.06855152547359467,
      "pose_mae_dy": 0.07988067716360092,
      "pose_rmse_dtheta": 0.4853690564632416,
      "pose_rmse_dx": 0.15624353289604187,
      "pose_rmse_dy": 0.18410272896289825,
      "pose_rmse_mean": 0.2752384543418884,
      "rmse_dtheta": 0.053575724363327026,
      "rmse_dx": 0.018670327961444855,
      "rmse_dy": 0.00853079091757536,
      "rmse_mean": 0.02692561410367489,
      "rotation_flip": 0.0038759689778089523,
      "sparse_tokens": 9122.0,
      "step": 911,
      "turn_loss": 0.16850577294826508,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.042371306448615496,
      "grad_norm": 0.6376253962516785,
      "learning_rate": 9.89101273747487e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.012714034877717495,
      "mae_dx": 0.0022711828351020813,
      "mae_dy": 0.0032357117161154747,
      "pose_mae_dtheta": 0.09669455140829086,
      "pose_mae_dx": 0.028094928711652756,
      "pose_mae_dy": 0.031284794211387634,
      "pose_rmse_dtheta": 0.2758978009223938,
      "pose_rmse_dx": 0.08112267404794693,
      "pose_rmse_dy": 0.08321817964315414,
      "pose_rmse_mean": 0.1467462182044983,
      "rmse_dtheta": 0.03058379516005516,
      "rmse_dx": 0.0066613866947591305,
      "rmse_dy": 0.008536192588508129,
      "rmse_mean": 0.015260457992553711,
      "rotation_flip": 0.008645533584058285,
      "sparse_tokens": 32057.0,
      "step": 912,
      "turn_loss": 0.12039349973201752,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.04241776621445828,
      "grad_norm": 0.49287304282188416,
      "learning_rate": 9.890738003669029e-06,
      "loss": 0.134,
      "mae_dtheta": 0.012296836823225021,
      "mae_dx": 0.002879013307392597,
      "mae_dy": 0.003288028994575143,
      "pose_mae_dtheta": 0.08672035485506058,
      "pose_mae_dx": 0.037246327847242355,
      "pose_mae_dy": 0.03236464783549309,
      "pose_rmse_dtheta": 0.22717314958572388,
      "pose_rmse_dx": 0.09573668986558914,
      "pose_rmse_dy": 0.08822405338287354,
      "pose_rmse_mean": 0.13704463839530945,
      "rmse_dtheta": 0.02939341776072979,
      "rmse_dx": 0.00919382181018591,
      "rmse_dy": 0.008040393702685833,
      "rmse_mean": 0.015542544424533844,
      "rotation_flip": 0.003423192072659731,
      "sparse_tokens": 32137.0,
      "step": 913,
      "turn_loss": 0.1187378391623497,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11990.0,
      "epoch": 0.04246422598030106,
      "grad_norm": 0.41746076941490173,
      "learning_rate": 9.890462927851255e-06,
      "loss": 0.1328,
      "mae_dtheta": 0.04272838681936264,
      "mae_dx": 0.014435570687055588,
      "mae_dy": 0.006203617434948683,
      "pose_mae_dtheta": 0.34503617882728577,
      "pose_mae_dx": 0.10529197007417679,
      "pose_mae_dy": 0.06565674394369125,
      "pose_rmse_dtheta": 0.5807232856750488,
      "pose_rmse_dx": 0.2440556138753891,
      "pose_rmse_dy": 0.17366817593574524,
      "pose_rmse_mean": 0.3328157067298889,
      "rmse_dtheta": 0.06310350447893143,
      "rmse_dx": 0.027140799909830093,
      "rmse_dy": 0.015476887114346027,
      "rmse_mean": 0.035240400582551956,
      "rotation_flip": 0.01773049682378769,
      "sparse_tokens": 10155.0,
      "step": 914,
      "turn_loss": 0.3426577150821686,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 6519.0,
      "epoch": 0.04251068574614384,
      "grad_norm": 0.6214786767959595,
      "learning_rate": 9.890187510040783e-06,
      "loss": 0.1107,
      "mae_dtheta": 0.03458581119775772,
      "mae_dx": 0.003912096843123436,
      "mae_dy": 0.003492665244266391,
      "pose_mae_dtheta": 0.2683001756668091,
      "pose_mae_dx": 0.018839431926608086,
      "pose_mae_dy": 0.047612279653549194,
      "pose_rmse_dtheta": 0.5564613938331604,
      "pose_rmse_dx": 0.038461267948150635,
      "pose_rmse_dy": 0.12134991586208344,
      "pose_rmse_mean": 0.23875753581523895,
      "rmse_dtheta": 0.05863884091377258,
      "rmse_dx": 0.01188706699758768,
      "rmse_dy": 0.00781320035457611,
      "rmse_mean": 0.026113037019968033,
      "rotation_flip": 0.019801979884505272,
      "sparse_tokens": 5578.0,
      "step": 915,
      "turn_loss": 0.17251329123973846,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.04255714551198662,
      "grad_norm": 0.3836750090122223,
      "learning_rate": 9.889911750256873e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.014198364689946175,
      "mae_dx": 0.0023578666150569916,
      "mae_dy": 0.0048967208713293076,
      "pose_mae_dtheta": 0.10279373824596405,
      "pose_mae_dx": 0.03864714130759239,
      "pose_mae_dy": 0.05859130993485451,
      "pose_rmse_dtheta": 0.20606841146945953,
      "pose_rmse_dx": 0.0971347838640213,
      "pose_rmse_dy": 0.1545904129743576,
      "pose_rmse_mean": 0.15259787440299988,
      "rmse_dtheta": 0.026179220527410507,
      "rmse_dx": 0.006287736352533102,
      "rmse_dy": 0.01077980175614357,
      "rmse_mean": 0.014415586367249489,
      "rotation_flip": 0.005190311465412378,
      "sparse_tokens": 32073.0,
      "step": 916,
      "turn_loss": 0.13164633512496948,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.0426036052778294,
      "grad_norm": 0.47215333580970764,
      "learning_rate": 9.88963564851881e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.01346072368323803,
      "mae_dx": 0.003604854689911008,
      "mae_dy": 0.00434983242303133,
      "pose_mae_dtheta": 0.09830930829048157,
      "pose_mae_dx": 0.03927372768521309,
      "pose_mae_dy": 0.04335460066795349,
      "pose_rmse_dtheta": 0.22923576831817627,
      "pose_rmse_dx": 0.10314460843801498,
      "pose_rmse_dy": 0.11172595620155334,
      "pose_rmse_mean": 0.1480354517698288,
      "rmse_dtheta": 0.02807086892426014,
      "rmse_dx": 0.010607737116515636,
      "rmse_dy": 0.0100868446752429,
      "rmse_mean": 0.016255151480436325,
      "rotation_flip": 0.00499583687633276,
      "sparse_tokens": 32057.0,
      "step": 917,
      "turn_loss": 0.11844168603420258,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.04265006504367218,
      "grad_norm": 0.4667212665081024,
      "learning_rate": 9.889359204845903e-06,
      "loss": 0.1276,
      "mae_dtheta": 0.012901048175990582,
      "mae_dx": 0.001921341521665454,
      "mae_dy": 0.0030946568585932255,
      "pose_mae_dtheta": 0.1000940352678299,
      "pose_mae_dx": 0.032599419355392456,
      "pose_mae_dy": 0.04247475787997246,
      "pose_rmse_dtheta": 0.24606597423553467,
      "pose_rmse_dx": 0.09381061047315598,
      "pose_rmse_dy": 0.10211358219385147,
      "pose_rmse_mean": 0.14733006060123444,
      "rmse_dtheta": 0.027944233268499374,
      "rmse_dx": 0.0054407985880970955,
      "rmse_dy": 0.007524470333009958,
      "rmse_mean": 0.013636501505970955,
      "rotation_flip": 0.004847309552133083,
      "sparse_tokens": 32041.0,
      "step": 918,
      "turn_loss": 0.10862608999013901,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.04269652480951496,
      "grad_norm": 0.5341992974281311,
      "learning_rate": 9.88908241925748e-06,
      "loss": 0.1596,
      "mae_dtheta": 0.012096788734197617,
      "mae_dx": 0.0022406945936381817,
      "mae_dy": 0.0032076947391033173,
      "pose_mae_dtheta": 0.08006320893764496,
      "pose_mae_dx": 0.027997242286801338,
      "pose_mae_dy": 0.03547372668981552,
      "pose_rmse_dtheta": 0.15614178776741028,
      "pose_rmse_dx": 0.06801530718803406,
      "pose_rmse_dy": 0.07306541502475739,
      "pose_rmse_mean": 0.09907416999340057,
      "rmse_dtheta": 0.022280985489487648,
      "rmse_dx": 0.007035457994788885,
      "rmse_dy": 0.006277077831327915,
      "rmse_mean": 0.01186450757086277,
      "rotation_flip": 0.004543865565210581,
      "sparse_tokens": 32073.0,
      "step": 919,
      "turn_loss": 0.1138668805360794,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.04274298457535774,
      "grad_norm": 0.9257798194885254,
      "learning_rate": 9.8888052917729e-06,
      "loss": 0.1876,
      "mae_dtheta": 0.0259342510253191,
      "mae_dx": 0.008537333458662033,
      "mae_dy": 0.0033547107595950365,
      "pose_mae_dtheta": 0.19117829203605652,
      "pose_mae_dx": 0.06669927388429642,
      "pose_mae_dy": 0.04314606264233589,
      "pose_rmse_dtheta": 0.343593955039978,
      "pose_rmse_dx": 0.16954170167446136,
      "pose_rmse_dy": 0.11270222812891006,
      "pose_rmse_mean": 0.20861265063285828,
      "rmse_dtheta": 0.042798206210136414,
      "rmse_dx": 0.01987038366496563,
      "rmse_dy": 0.006861624773591757,
      "rmse_mean": 0.02317674085497856,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 23024.0,
      "step": 920,
      "turn_loss": 0.1888582706451416,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 29522.0,
      "epoch": 0.04278944434120052,
      "grad_norm": 0.5862299799919128,
      "learning_rate": 9.888527822411543e-06,
      "loss": 0.1772,
      "mae_dtheta": 0.023498857393860817,
      "mae_dx": 0.00922583881765604,
      "mae_dy": 0.004254726227372885,
      "pose_mae_dtheta": 0.17997102439403534,
      "pose_mae_dx": 0.0822906345129013,
      "pose_mae_dy": 0.0641530230641365,
      "pose_rmse_dtheta": 0.31999847292900085,
      "pose_rmse_dx": 0.201083704829216,
      "pose_rmse_dy": 0.1434842348098755,
      "pose_rmse_mean": 0.22152213752269745,
      "rmse_dtheta": 0.03769756481051445,
      "rmse_dx": 0.02122722938656807,
      "rmse_dy": 0.008547978475689888,
      "rmse_mean": 0.02249092422425747,
      "rotation_flip": 0.01290877815335989,
      "sparse_tokens": 21519.0,
      "step": 921,
      "turn_loss": 0.19281618297100067,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.0428359041070433,
      "grad_norm": 0.4414293169975281,
      "learning_rate": 9.888250011192812e-06,
      "loss": 0.116,
      "mae_dtheta": 0.015297472476959229,
      "mae_dx": 0.004993177484720945,
      "mae_dy": 0.005346086807549,
      "pose_mae_dtheta": 0.11381083726882935,
      "pose_mae_dx": 0.046903952956199646,
      "pose_mae_dy": 0.04978276789188385,
      "pose_rmse_dtheta": 0.2653134763240814,
      "pose_rmse_dx": 0.1184767484664917,
      "pose_rmse_dy": 0.1235014796257019,
      "pose_rmse_mean": 0.16909722983837128,
      "rmse_dtheta": 0.03200247883796692,
      "rmse_dx": 0.013337399810552597,
      "rmse_dy": 0.01276895310729742,
      "rmse_mean": 0.019369611516594887,
      "rotation_flip": 0.008140531368553638,
      "sparse_tokens": 32073.0,
      "step": 922,
      "turn_loss": 0.16477222740650177,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.04288236387288608,
      "grad_norm": 0.53131103515625,
      "learning_rate": 9.887971858136133e-06,
      "loss": 0.1872,
      "mae_dtheta": 0.048338450491428375,
      "mae_dx": 0.02093832939863205,
      "mae_dy": 0.012889517471194267,
      "pose_mae_dtheta": 0.411526083946228,
      "pose_mae_dx": 0.1601881980895996,
      "pose_mae_dy": 0.1323956400156021,
      "pose_rmse_dtheta": 0.6474272608757019,
      "pose_rmse_dx": 0.2848719358444214,
      "pose_rmse_dy": 0.2801920771598816,
      "pose_rmse_mean": 0.40416377782821655,
      "rmse_dtheta": 0.06636592745780945,
      "rmse_dx": 0.032198403030633926,
      "rmse_dy": 0.02529880590736866,
      "rmse_mean": 0.04128771275281906,
      "rotation_flip": 0.021138211712241173,
      "sparse_tokens": 9147.0,
      "step": 923,
      "turn_loss": 0.5065755248069763,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.04292882363872886,
      "grad_norm": 0.5179336071014404,
      "learning_rate": 9.887693363260958e-06,
      "loss": 0.1469,
      "mae_dtheta": 0.006816404405981302,
      "mae_dx": 0.0016769894864410162,
      "mae_dy": 0.0006921263411641121,
      "pose_mae_dtheta": 0.04984790459275246,
      "pose_mae_dx": 0.01575210876762867,
      "pose_mae_dy": 0.011380918323993683,
      "pose_rmse_dtheta": 0.18791823089122772,
      "pose_rmse_dx": 0.035272352397441864,
      "pose_rmse_dy": 0.03936423733830452,
      "pose_rmse_mean": 0.08751827478408813,
      "rmse_dtheta": 0.023008964955806732,
      "rmse_dx": 0.00444395188242197,
      "rmse_dy": 0.0017684753984212875,
      "rmse_mean": 0.009740464389324188,
      "rotation_flip": 0.0014251781394705176,
      "sparse_tokens": 32201.0,
      "step": 924,
      "turn_loss": 0.05170285701751709,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.04297528340457164,
      "grad_norm": 0.6405676603317261,
      "learning_rate": 9.887414526586764e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.01662570796906948,
      "mae_dx": 0.007534705568104982,
      "mae_dy": 0.004457245115190744,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6405677795410156,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 128.28509521484375,
      "model/head/act_norm_mean": 102.40763346354167,
      "model/head/act_norm_min": 71.67655181884766,
      "model/head/act_over_embed": 70.37548447151576,
      "model/head/grad_frac": 0.10779807716608047,
      "model/head/grad_norm": 0.06905197352170944,
      "model/head/grad_zero_frac": 0.00016593313193880022,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.67333984375,
      "model/head/update_ratio": 0.001205088454298675,
      "model/head/weight_delta": 3.360438585281372,
      "model/head/weight_delta_rel": 0.05895204469561577,
      "model/head/weight_norm": 57.30033874511719,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4114461839199066,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4114021888146034,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4113837778568268,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2827194357613702,
      "model/modality_embedder.encoders.pose/grad_frac": 0.15360599756240845,
      "model/modality_embedder.encoders.pose/grad_norm": 0.09839504957199097,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5335036057692307,
      "model/modality_embedder.encoders.pose/update_ratio": 0.003207304049283266,
      "model/modality_embedder.encoders.pose/weight_delta": 1.0271227359771729,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.033559300005435944,
      "model/modality_embedder.encoders.pose/weight_norm": 30.678428649902344,
      "model/modality_embedder/grad_frac": 0.15360599756240845,
      "model/modality_embedder/grad_norm": 0.09839504957199097,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5335036057692307,
      "model/modality_embedder/update_ratio": 0.003207304049283266,
      "model/modality_embedder/weight_delta": 1.0271227359771729,
      "model/modality_embedder/weight_delta_rel": 0.033559300005435944,
      "model/modality_embedder/weight_norm": 30.678428649902344,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 64.77394104003906,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.58118902943122,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.21692943572998,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.518004509447621,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1102026179432869,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0705922469496727,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002565742004662752,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.5276606678962708,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.019228274002671242,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.513383865356445,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 65.68378448486328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.510881696428573,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.620584487915039,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.156898014128085,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08848366141319275,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05667978152632713,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001954407664015889,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.6361499428749084,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.022036731243133545,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.001001358032227,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 67.55406188964844,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.329034391534393,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.870569229125977,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.406349568018516,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09301405400037766,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.059581805020570755,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019910773262381554,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.6644308567047119,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.022310344502329826,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.92440414428711,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 68.38094329833984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.38660765955688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.891494750976562,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.820333181108005,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10414057224988937,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06670909374952316,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 8.574080129619688e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022717968095093966,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.5628882646560669,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0192368496209383,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.364023208618164,
      "model/normalizer/grad_frac": 0.43457308411598206,
      "model/normalizer/grad_norm": 0.27837350964546204,
      "model/normalizer/grad_zero_frac": 0.0001229007903020829,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0035784109495580196,
      "model/normalizer/weight_delta": 1.2319294214248657,
      "model/normalizer/weight_delta_rel": 0.015866538509726524,
      "model/normalizer/weight_norm": 77.79249572753906,
      "pose_mae_dtheta": 0.10669495910406113,
      "pose_mae_dx": 0.051437072455883026,
      "pose_mae_dy": 0.0539642833173275,
      "pose_rmse_dtheta": 0.17878574132919312,
      "pose_rmse_dx": 0.13324712216854095,
      "pose_rmse_dy": 0.12100766599178314,
      "pose_rmse_mean": 0.14434686303138733,
      "rmse_dtheta": 0.026627574115991592,
      "rmse_dx": 0.018426381051540375,
      "rmse_dy": 0.010483447462320328,
      "rmse_mean": 0.01851246878504753,
      "rotation_flip": 0.0,
      "sparse_tokens": 3221.0,
      "step": 925,
      "turn_loss": 0.17720794677734375,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.04302174317041442,
      "grad_norm": 0.4495103359222412,
      "learning_rate": 9.887135348133048e-06,
      "loss": 0.112,
      "mae_dtheta": 0.025065351277589798,
      "mae_dx": 0.007041397038847208,
      "mae_dy": 0.004006623290479183,
      "pose_mae_dtheta": 0.22367335855960846,
      "pose_mae_dx": 0.07478279620409012,
      "pose_mae_dy": 0.05023401230573654,
      "pose_rmse_dtheta": 0.345767617225647,
      "pose_rmse_dx": 0.17252515256404877,
      "pose_rmse_dy": 0.1292169690132141,
      "pose_rmse_mean": 0.21583658456802368,
      "rmse_dtheta": 0.039087213575839996,
      "rmse_dx": 0.017292272299528122,
      "rmse_dy": 0.008140070363879204,
      "rmse_mean": 0.021506518125534058,
      "rotation_flip": 0.008152173832058907,
      "sparse_tokens": 5388.0,
      "step": 926,
      "turn_loss": 0.20539851486682892,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.043068202936257204,
      "grad_norm": 0.7759320139884949,
      "learning_rate": 9.886855827919336e-06,
      "loss": 0.1919,
      "mae_dtheta": 0.010983925312757492,
      "mae_dx": 0.0023306456860154867,
      "mae_dy": 0.0025399529840797186,
      "pose_mae_dtheta": 0.08044198900461197,
      "pose_mae_dx": 0.027432966977357864,
      "pose_mae_dy": 0.028907081112265587,
      "pose_rmse_dtheta": 0.202936053276062,
      "pose_rmse_dx": 0.07002174854278564,
      "pose_rmse_dy": 0.07869298756122589,
      "pose_rmse_mean": 0.11721692979335785,
      "rmse_dtheta": 0.023680146783590317,
      "rmse_dx": 0.006298349238932133,
      "rmse_dy": 0.005854598246514797,
      "rmse_mean": 0.011944364756345749,
      "rotation_flip": 0.002111486392095685,
      "sparse_tokens": 32121.0,
      "step": 927,
      "turn_loss": 0.08760079741477966,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.04311466270209998,
      "grad_norm": 0.7387324571609497,
      "learning_rate": 9.88657596596517e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.04381519556045532,
      "mae_dx": 0.02133132517337799,
      "mae_dy": 0.008728128857910633,
      "pose_mae_dtheta": 0.4003317952156067,
      "pose_mae_dx": 0.13566561043262482,
      "pose_mae_dy": 0.10296136140823364,
      "pose_rmse_dtheta": 0.6439933180809021,
      "pose_rmse_dx": 0.2671113610267639,
      "pose_rmse_dy": 0.22134001553058624,
      "pose_rmse_mean": 0.3774815797805786,
      "rmse_dtheta": 0.06027275323867798,
      "rmse_dx": 0.034202199429273605,
      "rmse_dy": 0.01482534408569336,
      "rmse_mean": 0.03643343597650528,
      "rotation_flip": 0.0045045046135783195,
      "sparse_tokens": 3735.0,
      "step": 928,
      "turn_loss": 0.3482024371623993,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.043161122467942764,
      "grad_norm": 0.962687075138092,
      "learning_rate": 9.886295762290125e-06,
      "loss": 0.2081,
      "mae_dtheta": 0.039305415004491806,
      "mae_dx": 0.009653221815824509,
      "mae_dy": 0.005345383659005165,
      "pose_mae_dtheta": 0.3151888847351074,
      "pose_mae_dx": 0.07922932505607605,
      "pose_mae_dy": 0.08533872663974762,
      "pose_rmse_dtheta": 0.5381520986557007,
      "pose_rmse_dx": 0.18898290395736694,
      "pose_rmse_dy": 0.1902894675731659,
      "pose_rmse_mean": 0.3058081567287445,
      "rmse_dtheta": 0.05726591497659683,
      "rmse_dx": 0.022317921742796898,
      "rmse_dy": 0.009314244613051414,
      "rmse_mean": 0.029632695019245148,
      "rotation_flip": 0.011990407481789589,
      "sparse_tokens": 6418.0,
      "step": 929,
      "turn_loss": 0.25030234456062317,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.04320758223378554,
      "grad_norm": 0.8844514489173889,
      "learning_rate": 9.886015216913795e-06,
      "loss": 0.3053,
      "mae_dtheta": 0.035742420703172684,
      "mae_dx": 0.01838776469230652,
      "mae_dy": 0.007464595139026642,
      "pose_mae_dtheta": 0.3001265227794647,
      "pose_mae_dx": 0.17281359434127808,
      "pose_mae_dy": 0.11413387954235077,
      "pose_rmse_dtheta": 0.5117311477661133,
      "pose_rmse_dx": 0.35620561242103577,
      "pose_rmse_dy": 0.21628081798553467,
      "pose_rmse_mean": 0.3614058494567871,
      "rmse_dtheta": 0.05019663646817207,
      "rmse_dx": 0.03396153077483177,
      "rmse_dy": 0.01285542268306017,
      "rmse_mean": 0.032337866723537445,
      "rotation_flip": 0.013966480270028114,
      "sparse_tokens": 7603.0,
      "step": 930,
      "turn_loss": 0.29393935203552246,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.043254041999628325,
      "grad_norm": 0.5093082189559937,
      "learning_rate": 9.885734329855798e-06,
      "loss": 0.1161,
      "mae_dtheta": 0.011900685727596283,
      "mae_dx": 0.0023830030113458633,
      "mae_dy": 0.0028950402047485113,
      "pose_mae_dtheta": 0.09087551385164261,
      "pose_mae_dx": 0.02749364636838436,
      "pose_mae_dy": 0.034258436411619186,
      "pose_rmse_dtheta": 0.2417748123407364,
      "pose_rmse_dx": 0.07573486119508743,
      "pose_rmse_dy": 0.10950060933828354,
      "pose_rmse_mean": 0.14233677089214325,
      "rmse_dtheta": 0.027400394901633263,
      "rmse_dx": 0.006951331160962582,
      "rmse_dy": 0.008032714016735554,
      "rmse_mean": 0.014128146693110466,
      "rotation_flip": 0.0023847375996410847,
      "sparse_tokens": 32153.0,
      "step": 931,
      "turn_loss": 0.11037905514240265,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.0433005017654711,
      "grad_norm": 0.5438427925109863,
      "learning_rate": 9.885453101135778e-06,
      "loss": 0.1406,
      "mae_dtheta": 0.037396036088466644,
      "mae_dx": 0.016810201108455658,
      "mae_dy": 0.015516730956733227,
      "pose_mae_dtheta": 0.3156352639198303,
      "pose_mae_dx": 0.16102038323879242,
      "pose_mae_dy": 0.12120962888002396,
      "pose_rmse_dtheta": 0.5621130466461182,
      "pose_rmse_dx": 0.31093156337738037,
      "pose_rmse_dy": 0.24570973217487335,
      "pose_rmse_mean": 0.37291812896728516,
      "rmse_dtheta": 0.05654554441571236,
      "rmse_dx": 0.028178760781884193,
      "rmse_dy": 0.02774452045559883,
      "rmse_mean": 0.03748960793018341,
      "rotation_flip": 0.01149425283074379,
      "sparse_tokens": 8806.0,
      "step": 932,
      "turn_loss": 0.5238441228866577,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.043346961531313885,
      "grad_norm": 0.5350698828697205,
      "learning_rate": 9.885171530773398e-06,
      "loss": 0.0932,
      "mae_dtheta": 0.03708983585238457,
      "mae_dx": 0.011807912029325962,
      "mae_dy": 0.0054260739125311375,
      "pose_mae_dtheta": 0.26262837648391724,
      "pose_mae_dx": 0.09963918477296829,
      "pose_mae_dy": 0.06390450894832611,
      "pose_rmse_dtheta": 0.49632546305656433,
      "pose_rmse_dx": 0.22142139077186584,
      "pose_rmse_dy": 0.1274944394826889,
      "pose_rmse_mean": 0.28174710273742676,
      "rmse_dtheta": 0.05491280183196068,
      "rmse_dx": 0.024178998544812202,
      "rmse_dy": 0.009907728992402554,
      "rmse_mean": 0.029666511341929436,
      "rotation_flip": 0.02504817023873329,
      "sparse_tokens": 10160.0,
      "step": 933,
      "turn_loss": 0.29678818583488464,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.04339342129715666,
      "grad_norm": 0.4911102056503296,
      "learning_rate": 9.884889618788353e-06,
      "loss": 0.1508,
      "mae_dtheta": 0.033531829714775085,
      "mae_dx": 0.01244816742837429,
      "mae_dy": 0.0037992727011442184,
      "pose_mae_dtheta": 0.24837876856327057,
      "pose_mae_dx": 0.09735682606697083,
      "pose_mae_dy": 0.038261763751506805,
      "pose_rmse_dtheta": 0.43364831805229187,
      "pose_rmse_dx": 0.2172277867794037,
      "pose_rmse_dy": 0.08260653167963028,
      "pose_rmse_mean": 0.24449422955513,
      "rmse_dtheta": 0.05070153623819351,
      "rmse_dx": 0.024714559316635132,
      "rmse_dy": 0.007767674513161182,
      "rmse_mean": 0.027727924287319183,
      "rotation_flip": 0.013118062168359756,
      "sparse_tokens": 17693.0,
      "step": 934,
      "turn_loss": 0.24969713389873505,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.043439881062999446,
      "grad_norm": 0.6420199275016785,
      "learning_rate": 9.884607365200355e-06,
      "loss": 0.2102,
      "mae_dtheta": 0.044960808008909225,
      "mae_dx": 0.016446055844426155,
      "mae_dy": 0.007622673176229,
      "pose_mae_dtheta": 0.3739401400089264,
      "pose_mae_dx": 0.13616923987865448,
      "pose_mae_dy": 0.08360769599676132,
      "pose_rmse_dtheta": 0.5954281091690063,
      "pose_rmse_dx": 0.27354177832603455,
      "pose_rmse_dy": 0.16760841012001038,
      "pose_rmse_mean": 0.3455260992050171,
      "rmse_dtheta": 0.06042502447962761,
      "rmse_dx": 0.029047373682260513,
      "rmse_dy": 0.013796724379062653,
      "rmse_mean": 0.034423042088747025,
      "rotation_flip": 0.0061349691823124886,
      "sparse_tokens": 13345.0,
      "step": 935,
      "turn_loss": 0.40369126200675964,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.04348634082884222,
      "grad_norm": 0.5287564992904663,
      "learning_rate": 9.884324770029143e-06,
      "loss": 0.1289,
      "mae_dtheta": 0.042467422783374786,
      "mae_dx": 0.01296128612011671,
      "mae_dy": 0.005665468983352184,
      "pose_mae_dtheta": 0.3679150640964508,
      "pose_mae_dx": 0.10699830949306488,
      "pose_mae_dy": 0.06721819192171097,
      "pose_rmse_dtheta": 0.5946390628814697,
      "pose_rmse_dx": 0.2060817927122116,
      "pose_rmse_dy": 0.1255021095275879,
      "pose_rmse_mean": 0.3087410032749176,
      "rmse_dtheta": 0.05991482362151146,
      "rmse_dx": 0.02381446398794651,
      "rmse_dy": 0.009867419488728046,
      "rmse_mean": 0.031198903918266296,
      "rotation_flip": 0.012318029068410397,
      "sparse_tokens": 15754.0,
      "step": 936,
      "turn_loss": 0.286401629447937,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.043532800594685006,
      "grad_norm": 1.1882346868515015,
      "learning_rate": 9.884041833294477e-06,
      "loss": 0.2561,
      "mae_dtheta": 0.03221608325839043,
      "mae_dx": 0.00760690588504076,
      "mae_dy": 0.0048781754449009895,
      "pose_mae_dtheta": 0.2715109884738922,
      "pose_mae_dx": 0.057386890053749084,
      "pose_mae_dy": 0.05175276845693588,
      "pose_rmse_dtheta": 0.5125519633293152,
      "pose_rmse_dx": 0.11873593181371689,
      "pose_rmse_dy": 0.11666779220104218,
      "pose_rmse_mean": 0.24931856989860535,
      "rmse_dtheta": 0.05360180512070656,
      "rmse_dx": 0.01626628264784813,
      "rmse_dy": 0.01090386975556612,
      "rmse_mean": 0.02692398801445961,
      "rotation_flip": 0.005305039696395397,
      "sparse_tokens": 6278.0,
      "step": 937,
      "turn_loss": 0.29338833689689636,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.04357926036052778,
      "grad_norm": 0.7236722111701965,
      "learning_rate": 9.883758555016143e-06,
      "loss": 0.073,
      "mae_dtheta": 0.008031769655644894,
      "mae_dx": 0.0024707107804715633,
      "mae_dy": 0.002275402657687664,
      "pose_mae_dtheta": 0.06072225421667099,
      "pose_mae_dx": 0.02999400533735752,
      "pose_mae_dy": 0.030256902799010277,
      "pose_rmse_dtheta": 0.16216883063316345,
      "pose_rmse_dx": 0.09204601496458054,
      "pose_rmse_dy": 0.08932701498270035,
      "pose_rmse_mean": 0.11451395601034164,
      "rmse_dtheta": 0.020090168341994286,
      "rmse_dx": 0.008466373197734356,
      "rmse_dy": 0.006244305986911058,
      "rmse_mean": 0.011600282043218613,
      "rotation_flip": 0.00644468329846859,
      "sparse_tokens": 32057.0,
      "step": 938,
      "turn_loss": 0.06407377123832703,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.04362572012637056,
      "grad_norm": 0.4945533871650696,
      "learning_rate": 9.883474935213954e-06,
      "loss": 0.1132,
      "mae_dtheta": 0.04921261593699455,
      "mae_dx": 0.016224969178438187,
      "mae_dy": 0.004653035197407007,
      "pose_mae_dtheta": 0.44071733951568604,
      "pose_mae_dx": 0.12796305119991302,
      "pose_mae_dy": 0.056827422231435776,
      "pose_rmse_dtheta": 0.6782859563827515,
      "pose_rmse_dx": 0.27930864691734314,
      "pose_rmse_dy": 0.15356363356113434,
      "pose_rmse_mean": 0.3703860938549042,
      "rmse_dtheta": 0.06636707484722137,
      "rmse_dx": 0.028677474707365036,
      "rmse_dy": 0.009564611129462719,
      "rmse_mean": 0.0348697230219841,
      "rotation_flip": 0.01600000075995922,
      "sparse_tokens": 6107.0,
      "step": 939,
      "turn_loss": 0.26949095726013184,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 13607.0,
      "epoch": 0.04367217989221334,
      "grad_norm": 0.8265714645385742,
      "learning_rate": 9.883190973907742e-06,
      "loss": 0.1678,
      "mae_dtheta": 0.0526287741959095,
      "mae_dx": 0.011308150365948677,
      "mae_dy": 0.005758282262831926,
      "pose_mae_dtheta": 0.4635605812072754,
      "pose_mae_dx": 0.07822757959365845,
      "pose_mae_dy": 0.07677255570888519,
      "pose_rmse_dtheta": 0.7187346816062927,
      "pose_rmse_dx": 0.17190851271152496,
      "pose_rmse_dy": 0.15717601776123047,
      "pose_rmse_mean": 0.34927305579185486,
      "rmse_dtheta": 0.06957504898309708,
      "rmse_dx": 0.02287558652460575,
      "rmse_dy": 0.011709795333445072,
      "rmse_mean": 0.03472014516592026,
      "rotation_flip": 0.024113474413752556,
      "sparse_tokens": 10460.0,
      "step": 940,
      "turn_loss": 0.3599662184715271,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.04371863965805612,
      "grad_norm": 0.5670735836029053,
      "learning_rate": 9.882906671117363e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.03705764189362526,
      "mae_dx": 0.009985757991671562,
      "mae_dy": 0.004756107926368713,
      "pose_mae_dtheta": 0.28044575452804565,
      "pose_mae_dx": 0.06873355060815811,
      "pose_mae_dy": 0.05513579770922661,
      "pose_rmse_dtheta": 0.5032069087028503,
      "pose_rmse_dx": 0.17149311304092407,
      "pose_rmse_dy": 0.1404295265674591,
      "pose_rmse_mean": 0.2717098593711853,
      "rmse_dtheta": 0.05803893879055977,
      "rmse_dx": 0.021589651703834534,
      "rmse_dy": 0.011448919773101807,
      "rmse_mean": 0.030359169468283653,
      "rotation_flip": 0.011612903326749802,
      "sparse_tokens": 12715.0,
      "step": 941,
      "turn_loss": 0.2600662410259247,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.043765099423898904,
      "grad_norm": 0.6948757767677307,
      "learning_rate": 9.882622026862699e-06,
      "loss": 0.1523,
      "mae_dtheta": 0.012161779217422009,
      "mae_dx": 0.002651248360052705,
      "mae_dy": 0.0032769169192761183,
      "pose_mae_dtheta": 0.07813817262649536,
      "pose_mae_dx": 0.03529413789510727,
      "pose_mae_dy": 0.035179752856492996,
      "pose_rmse_dtheta": 0.165769562125206,
      "pose_rmse_dx": 0.1049402728676796,
      "pose_rmse_dy": 0.08074924349784851,
      "pose_rmse_mean": 0.11715303361415863,
      "rmse_dtheta": 0.023704666644334793,
      "rmse_dx": 0.009034832939505577,
      "rmse_dy": 0.007840181700885296,
      "rmse_mean": 0.013526560738682747,
      "rotation_flip": 0.006149115972220898,
      "sparse_tokens": 32057.0,
      "step": 942,
      "turn_loss": 0.10297854244709015,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.04381155918974168,
      "grad_norm": 0.5336790680885315,
      "learning_rate": 9.882337041163656e-06,
      "loss": 0.0814,
      "mae_dtheta": 0.010140149854123592,
      "mae_dx": 0.0026267163921147585,
      "mae_dy": 0.0019201827235519886,
      "pose_mae_dtheta": 0.07539521902799606,
      "pose_mae_dx": 0.02527451515197754,
      "pose_mae_dy": 0.026151882484555244,
      "pose_rmse_dtheta": 0.21686208248138428,
      "pose_rmse_dx": 0.08676490187644958,
      "pose_rmse_dy": 0.06919269263744354,
      "pose_rmse_mean": 0.12427322566509247,
      "rmse_dtheta": 0.0245633777230978,
      "rmse_dx": 0.009913396090269089,
      "rmse_dy": 0.004991583526134491,
      "rmse_mean": 0.013156118802726269,
      "rotation_flip": 0.0027203483041375875,
      "sparse_tokens": 32057.0,
      "step": 943,
      "turn_loss": 0.08566264808177948,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.043858018955584464,
      "grad_norm": 0.6629170775413513,
      "learning_rate": 9.882051714040164e-06,
      "loss": 0.1624,
      "mae_dtheta": 0.01139102689921856,
      "mae_dx": 0.002488380763679743,
      "mae_dy": 0.0026260504964739084,
      "pose_mae_dtheta": 0.07874692231416702,
      "pose_mae_dx": 0.02770748734474182,
      "pose_mae_dy": 0.028976360335946083,
      "pose_rmse_dtheta": 0.1892663538455963,
      "pose_rmse_dx": 0.08344744890928268,
      "pose_rmse_dy": 0.06785218417644501,
      "pose_rmse_mean": 0.1135219931602478,
      "rmse_dtheta": 0.024626290425658226,
      "rmse_dx": 0.00850722286850214,
      "rmse_dy": 0.006275430787354708,
      "rmse_mean": 0.013136315159499645,
      "rotation_flip": 0.00394218135625124,
      "sparse_tokens": 32105.0,
      "step": 944,
      "turn_loss": 0.0943196639418602,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.04390447872142724,
      "grad_norm": 0.8243533372879028,
      "learning_rate": 9.881766045512176e-06,
      "loss": 0.124,
      "mae_dtheta": 0.010697935707867146,
      "mae_dx": 0.0023479710798710585,
      "mae_dy": 0.0024673768784850836,
      "pose_mae_dtheta": 0.07019646465778351,
      "pose_mae_dx": 0.028663717210292816,
      "pose_mae_dy": 0.03025997243821621,
      "pose_rmse_dtheta": 0.15956895053386688,
      "pose_rmse_dx": 0.07214343547821045,
      "pose_rmse_dy": 0.060196150094270706,
      "pose_rmse_mean": 0.09730284661054611,
      "rmse_dtheta": 0.022566266357898712,
      "rmse_dx": 0.007196030113846064,
      "rmse_dy": 0.004834842402487993,
      "rmse_mean": 0.011532380245625973,
      "rotation_flip": 0.002556610619649291,
      "sparse_tokens": 32121.0,
      "step": 945,
      "turn_loss": 0.09433263540267944,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.043950938487270025,
      "grad_norm": 0.6569817662239075,
      "learning_rate": 9.881480035599667e-06,
      "loss": 0.17,
      "mae_dtheta": 0.011940669268369675,
      "mae_dx": 0.0017523171845823526,
      "mae_dy": 0.002790270373225212,
      "pose_mae_dtheta": 0.08012364059686661,
      "pose_mae_dx": 0.026828570291399956,
      "pose_mae_dy": 0.037096042186021805,
      "pose_rmse_dtheta": 0.18690159916877747,
      "pose_rmse_dx": 0.06484315544366837,
      "pose_rmse_dy": 0.10821220278739929,
      "pose_rmse_mean": 0.1199856549501419,
      "rmse_dtheta": 0.025462593883275986,
      "rmse_dx": 0.005146573763340712,
      "rmse_dy": 0.0065653701312839985,
      "rmse_mean": 0.012391513213515282,
      "rotation_flip": 0.003407800104469061,
      "sparse_tokens": 32089.0,
      "step": 946,
      "turn_loss": 0.10114789009094238,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.0439973982531128,
      "grad_norm": 0.6097108721733093,
      "learning_rate": 9.881193684322642e-06,
      "loss": 0.1595,
      "mae_dtheta": 0.010605725459754467,
      "mae_dx": 0.0016826956998556852,
      "mae_dy": 0.0024075813125818968,
      "pose_mae_dtheta": 0.07429646700620651,
      "pose_mae_dx": 0.02547263167798519,
      "pose_mae_dy": 0.0319645069539547,
      "pose_rmse_dtheta": 0.2056371420621872,
      "pose_rmse_dx": 0.07233241200447083,
      "pose_rmse_dy": 0.08710560947656631,
      "pose_rmse_mean": 0.12169171869754791,
      "rmse_dtheta": 0.024906326085329056,
      "rmse_dx": 0.004664433188736439,
      "rmse_dy": 0.005972512997686863,
      "rmse_mean": 0.011847756803035736,
      "rotation_flip": 0.003180372528731823,
      "sparse_tokens": 32105.0,
      "step": 947,
      "turn_loss": 0.083613820374012,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.044043858018955585,
      "grad_norm": 0.5951732993125916,
      "learning_rate": 9.880906991701118e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.011868582107126713,
      "mae_dx": 0.002250673482194543,
      "mae_dy": 0.002662219339981675,
      "pose_mae_dtheta": 0.07908833771944046,
      "pose_mae_dx": 0.026691971346735954,
      "pose_mae_dy": 0.03163367882370949,
      "pose_rmse_dtheta": 0.18706628680229187,
      "pose_rmse_dx": 0.061917755752801895,
      "pose_rmse_dy": 0.07261577993631363,
      "pose_rmse_mean": 0.10719993710517883,
      "rmse_dtheta": 0.024843338876962662,
      "rmse_dx": 0.006271468475461006,
      "rmse_dy": 0.005996283143758774,
      "rmse_mean": 0.012370362877845764,
      "rotation_flip": 0.004844570066779852,
      "sparse_tokens": 32121.0,
      "step": 948,
      "turn_loss": 0.1083589419722557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04409031778479836,
      "grad_norm": 0.5953964591026306,
      "learning_rate": 9.880619957755151e-06,
      "loss": 0.1685,
      "mae_dtheta": 0.0141465924680233,
      "mae_dx": 0.00252582342363894,
      "mae_dy": 0.003538256511092186,
      "pose_mae_dtheta": 0.10357734560966492,
      "pose_mae_dx": 0.036626189947128296,
      "pose_mae_dy": 0.045930806547403336,
      "pose_rmse_dtheta": 0.2343055158853531,
      "pose_rmse_dx": 0.0900595635175705,
      "pose_rmse_dy": 0.1062731146812439,
      "pose_rmse_mean": 0.14354607462882996,
      "rmse_dtheta": 0.027971981093287468,
      "rmse_dx": 0.007521622348576784,
      "rmse_dy": 0.007961786352097988,
      "rmse_mean": 0.01448513101786375,
      "rotation_flip": 0.007122507318854332,
      "sparse_tokens": 32089.0,
      "step": 949,
      "turn_loss": 0.10998542606830597,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12638.0,
      "epoch": 0.044136777550641146,
      "grad_norm": 0.5139885544776917,
      "learning_rate": 9.88033258250481e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.032853323966264725,
      "mae_dx": 0.010520090349018574,
      "mae_dy": 0.0035339943133294582,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.513988733291626,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 115.57489776611328,
      "model/head/act_norm_mean": 95.58821614583333,
      "model/head/act_norm_min": 78.99169921875,
      "model/head/act_over_embed": 65.68911704639578,
      "model/head/grad_frac": 0.10011149942874908,
      "model/head/grad_norm": 0.051456183195114136,
      "model/head/grad_zero_frac": 0.000186873076017946,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6752554086538461,
      "model/head/update_ratio": 0.0008978607947938144,
      "model/head/weight_delta": 3.414067029953003,
      "model/head/weight_delta_rel": 0.05989284813404083,
      "model/head/weight_norm": 57.309757232666016,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41144347190856934,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41144347190856934,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41144347190856934,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.282747805890042,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09863448888063431,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05069701746106148,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016524255042895675,
      "model/modality_embedder.encoders.pose/weight_delta": 1.0457292795181274,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.03416723385453224,
      "model/modality_embedder.encoders.pose/weight_norm": 30.68036460876465,
      "model/modality_embedder/grad_frac": 0.09863448888063431,
      "model/modality_embedder/grad_norm": 0.05069701746106148,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0016524255042895675,
      "model/modality_embedder/weight_delta": 1.0457292795181274,
      "model/modality_embedder/weight_delta_rel": 0.03416723385453224,
      "model/modality_embedder/weight_norm": 30.68036460876465,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 57.52378463745117,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.886230667480667,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.178359031677246,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.04042261681251,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07572886347770691,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.038923781365156174,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001414624392054975,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.5406625270843506,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.019702069461345673,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.515275955200195,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 58.484046936035156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.7946205993081,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.587808609008789,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.664676682444853,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07422113418579102,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.038148827850818634,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001315239118412137,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.6517095565795898,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.022575728595256805,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.00524139404297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 60.50809860229492,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.484411566442816,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.018627166748047,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.825916855132114,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07561037689447403,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03886288031935692,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012985074426978827,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.6823025941848755,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.02291044406592846,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.92888641357422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 60.64775848388672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.428946632071632,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.035743713378906,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.162219557256346,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08729486912488937,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.044868580996990204,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015278671635314822,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.5771996974945068,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.019725946709513664,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.36680793762207,
      "model/normalizer/grad_frac": 0.3317624032497406,
      "model/normalizer/grad_norm": 0.17052213847637177,
      "model/normalizer/grad_zero_frac": 0.00021743986872024834,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002191890263929963,
      "model/normalizer/weight_delta": 1.2631360292434692,
      "model/normalizer/weight_delta_rel": 0.01626846008002758,
      "model/normalizer/weight_norm": 77.79684448242188,
      "pose_mae_dtheta": 0.2506027817726135,
      "pose_mae_dx": 0.08231823146343231,
      "pose_mae_dy": 0.030834518373012543,
      "pose_rmse_dtheta": 0.46854275465011597,
      "pose_rmse_dx": 0.1932324320077896,
      "pose_rmse_dy": 0.0672357901930809,
      "pose_rmse_mean": 0.24300365149974823,
      "rmse_dtheta": 0.05019892007112503,
      "rmse_dx": 0.021444140002131462,
      "rmse_dy": 0.0064408862963318825,
      "rmse_mean": 0.0260279830545187,
      "rotation_flip": 0.011608623899519444,
      "sparse_tokens": 9606.0,
      "step": 950,
      "turn_loss": 0.2964235842227936,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.04418323731648392,
      "grad_norm": 0.5554210543632507,
      "learning_rate": 9.880044865970192e-06,
      "loss": 0.1519,
      "mae_dtheta": 0.012223000638186932,
      "mae_dx": 0.002561655594035983,
      "mae_dy": 0.003464602865278721,
      "pose_mae_dtheta": 0.09026370942592621,
      "pose_mae_dx": 0.025591382756829262,
      "pose_mae_dy": 0.03291486203670502,
      "pose_rmse_dtheta": 0.24854812026023865,
      "pose_rmse_dx": 0.07127582281827927,
      "pose_rmse_dy": 0.08279376477003098,
      "pose_rmse_mean": 0.1342059075832367,
      "rmse_dtheta": 0.028666140511631966,
      "rmse_dx": 0.00814800150692463,
      "rmse_dy": 0.009536342695355415,
      "rmse_mean": 0.015450162813067436,
      "rotation_flip": 0.004975124262273312,
      "sparse_tokens": 32105.0,
      "step": 951,
      "turn_loss": 0.11028816550970078,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29525.0,
      "epoch": 0.044229697082326706,
      "grad_norm": 1.0116175413131714,
      "learning_rate": 9.879756808171419e-06,
      "loss": 0.2159,
      "mae_dtheta": 0.02747453562915325,
      "mae_dx": 0.01038788165897131,
      "mae_dy": 0.0028045165818184614,
      "pose_mae_dtheta": 0.2029780149459839,
      "pose_mae_dx": 0.07298903912305832,
      "pose_mae_dy": 0.03537419065833092,
      "pose_rmse_dtheta": 0.378690630197525,
      "pose_rmse_dx": 0.1771383285522461,
      "pose_rmse_dy": 0.08999673277139664,
      "pose_rmse_mean": 0.21527522802352905,
      "rmse_dtheta": 0.04605775699019432,
      "rmse_dx": 0.022100601345300674,
      "rmse_dy": 0.005638439208269119,
      "rmse_mean": 0.02459893189370632,
      "rotation_flip": 0.012126111425459385,
      "sparse_tokens": 24054.0,
      "step": 952,
      "turn_loss": 0.18858647346496582,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.04427615684816948,
      "grad_norm": 1.22762131690979,
      "learning_rate": 9.879468409128631e-06,
      "loss": 0.1764,
      "mae_dtheta": 0.03424597159028053,
      "mae_dx": 0.010971910320222378,
      "mae_dy": 0.008176719769835472,
      "pose_mae_dtheta": 0.22044764459133148,
      "pose_mae_dx": 0.09127837419509888,
      "pose_mae_dy": 0.1045365110039711,
      "pose_rmse_dtheta": 0.34917551279067993,
      "pose_rmse_dx": 0.19909484684467316,
      "pose_rmse_dy": 0.20503970980644226,
      "pose_rmse_mean": 0.25110337138175964,
      "rmse_dtheta": 0.04875882342457771,
      "rmse_dx": 0.02273477427661419,
      "rmse_dy": 0.014405314810574055,
      "rmse_mean": 0.02863297238945961,
      "rotation_flip": 0.016286645084619522,
      "sparse_tokens": 5059.0,
      "step": 953,
      "turn_loss": 0.23503299057483673,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.04432261661401227,
      "grad_norm": 0.5194577574729919,
      "learning_rate": 9.879179668862e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.041071727871894836,
      "mae_dx": 0.01106734573841095,
      "mae_dy": 0.002566111972555518,
      "pose_mae_dtheta": 0.3044513463973999,
      "pose_mae_dx": 0.07833045721054077,
      "pose_mae_dy": 0.023241356015205383,
      "pose_rmse_dtheta": 0.4917644262313843,
      "pose_rmse_dx": 0.1749199479818344,
      "pose_rmse_dy": 0.05476110056042671,
      "pose_rmse_mean": 0.24048183858394623,
      "rmse_dtheta": 0.05966745316982269,
      "rmse_dx": 0.021942630410194397,
      "rmse_dy": 0.005902428179979324,
      "rmse_mean": 0.029170837253332138,
      "rotation_flip": 0.015037594363093376,
      "sparse_tokens": 6238.0,
      "step": 954,
      "turn_loss": 0.20734453201293945,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.044369076379855044,
      "grad_norm": 0.45871809124946594,
      "learning_rate": 9.878890587391715e-06,
      "loss": 0.1459,
      "mae_dtheta": 0.016214685514569283,
      "mae_dx": 0.0031972236465662718,
      "mae_dy": 0.004825438838452101,
      "pose_mae_dtheta": 0.11440758407115936,
      "pose_mae_dx": 0.045706383883953094,
      "pose_mae_dy": 0.05995414778590202,
      "pose_rmse_dtheta": 0.21815025806427002,
      "pose_rmse_dx": 0.1153680607676506,
      "pose_rmse_dy": 0.1510505974292755,
      "pose_rmse_mean": 0.1615229845046997,
      "rmse_dtheta": 0.02737901546061039,
      "rmse_dx": 0.008292702957987785,
      "rmse_dy": 0.010323829017579556,
      "rmse_mean": 0.015331849455833435,
      "rotation_flip": 0.012646221555769444,
      "sparse_tokens": 32137.0,
      "step": 955,
      "turn_loss": 0.14891387522220612,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.04441553614569783,
      "grad_norm": 0.6136651635169983,
      "learning_rate": 9.878601164737993e-06,
      "loss": 0.1374,
      "mae_dtheta": 0.01034852396696806,
      "mae_dx": 0.0025621294043958187,
      "mae_dy": 0.0030308749992400408,
      "pose_mae_dtheta": 0.07031925767660141,
      "pose_mae_dx": 0.03621592000126839,
      "pose_mae_dy": 0.031004449352622032,
      "pose_rmse_dtheta": 0.14609448611736298,
      "pose_rmse_dx": 0.09999987483024597,
      "pose_rmse_dy": 0.07321236282587051,
      "pose_rmse_mean": 0.10643558204174042,
      "rmse_dtheta": 0.020309356972575188,
      "rmse_dx": 0.006970087997615337,
      "rmse_dy": 0.007003379985690117,
      "rmse_mean": 0.011427609249949455,
      "rotation_flip": 0.0035928143188357353,
      "sparse_tokens": 32105.0,
      "step": 956,
      "turn_loss": 0.09493902325630188,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28553.0,
      "epoch": 0.044461995911540604,
      "grad_norm": 0.6973758339881897,
      "learning_rate": 9.878311400921072e-06,
      "loss": 0.2315,
      "mae_dtheta": 0.03415102884173393,
      "mae_dx": 0.01247463095933199,
      "mae_dy": 0.005729508586227894,
      "pose_mae_dtheta": 0.25358104705810547,
      "pose_mae_dx": 0.09743791073560715,
      "pose_mae_dy": 0.07059549540281296,
      "pose_rmse_dtheta": 0.46308860182762146,
      "pose_rmse_dx": 0.2291347086429596,
      "pose_rmse_dy": 0.1729397475719452,
      "pose_rmse_mean": 0.2883877158164978,
      "rmse_dtheta": 0.05291658639907837,
      "rmse_dx": 0.025422681123018265,
      "rmse_dy": 0.012115704827010632,
      "rmse_mean": 0.03015165589749813,
      "rotation_flip": 0.013840830884873867,
      "sparse_tokens": 22036.0,
      "step": 957,
      "turn_loss": 0.2689209282398224,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.04450845567738339,
      "grad_norm": 0.5720165967941284,
      "learning_rate": 9.878021295961218e-06,
      "loss": 0.1264,
      "mae_dtheta": 0.00994114764034748,
      "mae_dx": 0.003061379073187709,
      "mae_dy": 0.0017867577262222767,
      "pose_mae_dtheta": 0.07076966017484665,
      "pose_mae_dx": 0.030141575261950493,
      "pose_mae_dy": 0.025433499366044998,
      "pose_rmse_dtheta": 0.16950520873069763,
      "pose_rmse_dx": 0.0832938402891159,
      "pose_rmse_dy": 0.05990178510546684,
      "pose_rmse_mean": 0.10423360764980316,
      "rmse_dtheta": 0.021963972598314285,
      "rmse_dx": 0.00925595872104168,
      "rmse_dy": 0.004027263261377811,
      "rmse_mean": 0.011749065481126308,
      "rotation_flip": 0.002217294881120324,
      "sparse_tokens": 32121.0,
      "step": 958,
      "turn_loss": 0.09778551012277603,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.044554915443226165,
      "grad_norm": 0.6313222646713257,
      "learning_rate": 9.877730849878714e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.006506925914436579,
      "mae_dx": 0.0016432508127763867,
      "mae_dy": 0.001340945833362639,
      "pose_mae_dtheta": 0.04515999183058739,
      "pose_mae_dx": 0.0180013719946146,
      "pose_mae_dy": 0.016762491315603256,
      "pose_rmse_dtheta": 0.13706853985786438,
      "pose_rmse_dx": 0.050746239721775055,
      "pose_rmse_dy": 0.04718342795968056,
      "pose_rmse_mean": 0.07833273708820343,
      "rmse_dtheta": 0.01952073723077774,
      "rmse_dx": 0.004816946107894182,
      "rmse_dy": 0.0034792113583534956,
      "rmse_mean": 0.009272297844290733,
      "rotation_flip": 0.0017281105974689126,
      "sparse_tokens": 32089.0,
      "step": 959,
      "turn_loss": 0.05080043897032738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.04460137520906895,
      "grad_norm": 1.1161407232284546,
      "learning_rate": 9.877440062693876e-06,
      "loss": 0.2653,
      "mae_dtheta": 0.0434897355735302,
      "mae_dx": 0.016543203964829445,
      "mae_dy": 0.008360653184354305,
      "pose_mae_dtheta": 0.3607531785964966,
      "pose_mae_dx": 0.15669554471969604,
      "pose_mae_dy": 0.11939617991447449,
      "pose_rmse_dtheta": 0.5719746947288513,
      "pose_rmse_dx": 0.3203587830066681,
      "pose_rmse_dy": 0.23816479742527008,
      "pose_rmse_mean": 0.3768327832221985,
      "rmse_dtheta": 0.060072630643844604,
      "rmse_dx": 0.0306409765034914,
      "rmse_dy": 0.01381599996238947,
      "rmse_mean": 0.03484320268034935,
      "rotation_flip": 0.014814814552664757,
      "sparse_tokens": 4761.0,
      "step": 960,
      "turn_loss": 0.4654634892940521,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.044647834974911725,
      "grad_norm": 0.6766682863235474,
      "learning_rate": 9.877148934427037e-06,
      "loss": 0.1762,
      "mae_dtheta": 0.028601650148630142,
      "mae_dx": 0.010412091389298439,
      "mae_dy": 0.0036925612948834896,
      "pose_mae_dtheta": 0.23008333146572113,
      "pose_mae_dx": 0.09542586654424667,
      "pose_mae_dy": 0.036183807998895645,
      "pose_rmse_dtheta": 0.3840210735797882,
      "pose_rmse_dx": 0.2364296317100525,
      "pose_rmse_dy": 0.07591371238231659,
      "pose_rmse_mean": 0.23212149739265442,
      "rmse_dtheta": 0.04481930658221245,
      "rmse_dx": 0.02312261238694191,
      "rmse_dy": 0.006889989133924246,
      "rmse_mean": 0.024943970143795013,
      "rotation_flip": 0.0139860138297081,
      "sparse_tokens": 4273.0,
      "step": 961,
      "turn_loss": 0.2402516007423401,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.04469429474075451,
      "grad_norm": 0.9289306402206421,
      "learning_rate": 9.876857465098552e-06,
      "loss": 0.3209,
      "mae_dtheta": 0.03495454788208008,
      "mae_dx": 0.011525238864123821,
      "mae_dy": 0.005336955189704895,
      "pose_mae_dtheta": 0.2679459750652313,
      "pose_mae_dx": 0.09666931629180908,
      "pose_mae_dy": 0.06024288758635521,
      "pose_rmse_dtheta": 0.4767981171607971,
      "pose_rmse_dx": 0.2185107320547104,
      "pose_rmse_dy": 0.1479940563440323,
      "pose_rmse_mean": 0.2811009883880615,
      "rmse_dtheta": 0.053096093237400055,
      "rmse_dx": 0.023280872032046318,
      "rmse_dy": 0.011717296205461025,
      "rmse_mean": 0.029364755377173424,
      "rotation_flip": 0.008672447875142097,
      "sparse_tokens": 25060.0,
      "step": 962,
      "turn_loss": 0.30076083540916443,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.044740754506597286,
      "grad_norm": 0.5239875912666321,
      "learning_rate": 9.87656565472881e-06,
      "loss": 0.1501,
      "mae_dtheta": 0.011770015582442284,
      "mae_dx": 0.003035616595298052,
      "mae_dy": 0.0042999861761927605,
      "pose_mae_dtheta": 0.08260999619960785,
      "pose_mae_dx": 0.04029484838247299,
      "pose_mae_dy": 0.03806575387716293,
      "pose_rmse_dtheta": 0.17739000916481018,
      "pose_rmse_dx": 0.09587320685386658,
      "pose_rmse_dy": 0.08633881062269211,
      "pose_rmse_mean": 0.11986734718084335,
      "rmse_dtheta": 0.023130318149924278,
      "rmse_dx": 0.007069774903357029,
      "rmse_dy": 0.008977139368653297,
      "rmse_mean": 0.01305907778441906,
      "rotation_flip": 0.005962239112704992,
      "sparse_tokens": 32169.0,
      "step": 963,
      "turn_loss": 0.12639498710632324,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.04478721427244007,
      "grad_norm": 0.7026331424713135,
      "learning_rate": 9.876273503338214e-06,
      "loss": 0.1218,
      "mae_dtheta": 0.03796000778675079,
      "mae_dx": 0.009709280915558338,
      "mae_dy": 0.00835704430937767,
      "pose_mae_dtheta": 0.22493764758110046,
      "pose_mae_dx": 0.07288595288991928,
      "pose_mae_dy": 0.051620885729789734,
      "pose_rmse_dtheta": 0.38710352778434753,
      "pose_rmse_dx": 0.15459728240966797,
      "pose_rmse_dy": 0.10575328767299652,
      "pose_rmse_mean": 0.21581804752349854,
      "rmse_dtheta": 0.05781157687306404,
      "rmse_dx": 0.019141189754009247,
      "rmse_dy": 0.017289021983742714,
      "rmse_mean": 0.031413931399583817,
      "rotation_flip": 0.004273504484444857,
      "sparse_tokens": 3651.0,
      "step": 964,
      "turn_loss": 0.36512184143066406,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.044833674038282846,
      "grad_norm": 1.244646668434143,
      "learning_rate": 9.875981010947192e-06,
      "loss": 0.3325,
      "mae_dtheta": 0.04143905267119408,
      "mae_dx": 0.009078850038349628,
      "mae_dy": 0.008304000832140446,
      "pose_mae_dtheta": 0.28819340467453003,
      "pose_mae_dx": 0.09246499836444855,
      "pose_mae_dy": 0.09622674435377121,
      "pose_rmse_dtheta": 0.4583682119846344,
      "pose_rmse_dx": 0.19218812882900238,
      "pose_rmse_dy": 0.2025272101163864,
      "pose_rmse_mean": 0.28436118364334106,
      "rmse_dtheta": 0.05428902059793472,
      "rmse_dx": 0.018935002386569977,
      "rmse_dy": 0.015831034630537033,
      "rmse_mean": 0.029685020446777344,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 5419.0,
      "step": 965,
      "turn_loss": 0.3307829201221466,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04488013380412563,
      "grad_norm": 0.6443288326263428,
      "learning_rate": 9.875688177576203e-06,
      "loss": 0.0833,
      "mae_dtheta": 0.009963573887944221,
      "mae_dx": 0.0023208018392324448,
      "mae_dy": 0.002049305709078908,
      "pose_mae_dtheta": 0.07098998874425888,
      "pose_mae_dx": 0.028105244040489197,
      "pose_mae_dy": 0.02594737522304058,
      "pose_rmse_dtheta": 0.18584300577640533,
      "pose_rmse_dx": 0.08213697373867035,
      "pose_rmse_dy": 0.06958310306072235,
      "pose_rmse_mean": 0.11252103745937347,
      "rmse_dtheta": 0.022771712392568588,
      "rmse_dx": 0.00786042120307684,
      "rmse_dy": 0.00482031749561429,
      "rmse_mean": 0.01181748416274786,
      "rotation_flip": 0.006986492779105902,
      "sparse_tokens": 32089.0,
      "step": 966,
      "turn_loss": 0.07645631581544876,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.04492659356996841,
      "grad_norm": 0.6209676861763,
      "learning_rate": 9.875395003245724e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.011380553245544434,
      "mae_dx": 0.0025281787384301424,
      "mae_dy": 0.002337794518098235,
      "pose_mae_dtheta": 0.08095939457416534,
      "pose_mae_dx": 0.028157567605376244,
      "pose_mae_dy": 0.0344356968998909,
      "pose_rmse_dtheta": 0.20456524193286896,
      "pose_rmse_dx": 0.07150863856077194,
      "pose_rmse_dy": 0.07503717392683029,
      "pose_rmse_mean": 0.11703702062368393,
      "rmse_dtheta": 0.024303805083036423,
      "rmse_dx": 0.007737364619970322,
      "rmse_dy": 0.004783879034221172,
      "rmse_mean": 0.012275016866624355,
      "rotation_flip": 0.0026385225355625153,
      "sparse_tokens": 32073.0,
      "step": 967,
      "turn_loss": 0.1004459336400032,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.04497305333581119,
      "grad_norm": 0.9276450276374817,
      "learning_rate": 9.875101487976254e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.011611954309046268,
      "mae_dx": 0.0038782053161412477,
      "mae_dy": 0.0014228661311790347,
      "pose_mae_dtheta": 0.09123983234167099,
      "pose_mae_dx": 0.03617614880204201,
      "pose_mae_dy": 0.019837243482470512,
      "pose_rmse_dtheta": 0.25840017199516296,
      "pose_rmse_dx": 0.09573519974946976,
      "pose_rmse_dy": 0.05466711148619652,
      "pose_rmse_mean": 0.1362674981355667,
      "rmse_dtheta": 0.02831893414258957,
      "rmse_dx": 0.010413057170808315,
      "rmse_dy": 0.0033782245591282845,
      "rmse_mean": 0.014036739245057106,
      "rotation_flip": 0.004866180010139942,
      "sparse_tokens": 32185.0,
      "step": 968,
      "turn_loss": 0.08933698385953903,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.04501951310165397,
      "grad_norm": 0.45304420590400696,
      "learning_rate": 9.874807631788321e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.010943173430860043,
      "mae_dx": 0.001901100156828761,
      "mae_dy": 0.0026949718594551086,
      "pose_mae_dtheta": 0.07740072160959244,
      "pose_mae_dx": 0.02684340998530388,
      "pose_mae_dy": 0.03856484964489937,
      "pose_rmse_dtheta": 0.16577455401420593,
      "pose_rmse_dx": 0.08274753391742706,
      "pose_rmse_dy": 0.10745111852884293,
      "pose_rmse_mean": 0.11865773797035217,
      "rmse_dtheta": 0.022371593862771988,
      "rmse_dx": 0.006933416239917278,
      "rmse_dy": 0.006592122372239828,
      "rmse_mean": 0.011965710669755936,
      "rotation_flip": 0.0029154520016163588,
      "sparse_tokens": 32057.0,
      "step": 969,
      "turn_loss": 0.08834580332040787,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04506597286749675,
      "grad_norm": 0.6902282238006592,
      "learning_rate": 9.874513434702473e-06,
      "loss": 0.1558,
      "mae_dtheta": 0.009633812122046947,
      "mae_dx": 0.0021090940572321415,
      "mae_dy": 0.0018782804254442453,
      "pose_mae_dtheta": 0.07111411541700363,
      "pose_mae_dx": 0.023278169333934784,
      "pose_mae_dy": 0.029779328033328056,
      "pose_rmse_dtheta": 0.1676628738641739,
      "pose_rmse_dx": 0.05913449078798294,
      "pose_rmse_dy": 0.06999871879816055,
      "pose_rmse_mean": 0.09893202781677246,
      "rmse_dtheta": 0.021474964916706085,
      "rmse_dx": 0.006608402822166681,
      "rmse_dy": 0.003835185430943966,
      "rmse_mean": 0.010639517568051815,
      "rotation_flip": 0.0036264732480049133,
      "sparse_tokens": 32089.0,
      "step": 970,
      "turn_loss": 0.07781174033880234,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04511243263333953,
      "grad_norm": 0.5539613366127014,
      "learning_rate": 9.874218896739285e-06,
      "loss": 0.1777,
      "mae_dtheta": 0.012657823041081429,
      "mae_dx": 0.002075348747894168,
      "mae_dy": 0.002443068427965045,
      "pose_mae_dtheta": 0.09180783480405807,
      "pose_mae_dx": 0.0304137971252203,
      "pose_mae_dy": 0.033251240849494934,
      "pose_rmse_dtheta": 0.2383754402399063,
      "pose_rmse_dx": 0.0640062540769577,
      "pose_rmse_dy": 0.07041900604963303,
      "pose_rmse_mean": 0.12426690757274628,
      "rmse_dtheta": 0.028226491063833237,
      "rmse_dx": 0.005530509632080793,
      "rmse_dy": 0.004889403469860554,
      "rmse_mean": 0.01288213487714529,
      "rotation_flip": 0.0016806722851470113,
      "sparse_tokens": 32089.0,
      "step": 971,
      "turn_loss": 0.09855164587497711,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.04515889239918231,
      "grad_norm": 0.41383370757102966,
      "learning_rate": 9.873924017919352e-06,
      "loss": 0.1108,
      "mae_dtheta": 0.004543700721114874,
      "mae_dx": 0.002686274703592062,
      "mae_dy": 0.0007370806415565312,
      "pose_mae_dtheta": 0.034752100706100464,
      "pose_mae_dx": 0.02750174142420292,
      "pose_mae_dy": 0.011723607778549194,
      "pose_rmse_dtheta": 0.10936335474252701,
      "pose_rmse_dx": 0.10859852284193039,
      "pose_rmse_dy": 0.0376875177025795,
      "pose_rmse_mean": 0.0852164626121521,
      "rmse_dtheta": 0.015196316875517368,
      "rmse_dx": 0.01025347225368023,
      "rmse_dy": 0.0022033958230167627,
      "rmse_mean": 0.009217728860676289,
      "rotation_flip": 0.00324324332177639,
      "sparse_tokens": 32041.0,
      "step": 972,
      "turn_loss": 0.04610566049814224,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.04520535216502509,
      "grad_norm": 0.5991579294204712,
      "learning_rate": 9.873628798263297e-06,
      "loss": 0.1595,
      "mae_dtheta": 0.016687672585248947,
      "mae_dx": 0.0027654466684907675,
      "mae_dy": 0.004137562587857246,
      "pose_mae_dtheta": 0.12230988591909409,
      "pose_mae_dx": 0.04010294750332832,
      "pose_mae_dy": 0.05507444590330124,
      "pose_rmse_dtheta": 0.2752939462661743,
      "pose_rmse_dx": 0.09243721514940262,
      "pose_rmse_dy": 0.1309395283460617,
      "pose_rmse_mean": 0.16622357070446014,
      "rmse_dtheta": 0.03158543258905411,
      "rmse_dx": 0.00785316526889801,
      "rmse_dy": 0.00837694201618433,
      "rmse_mean": 0.015938512980937958,
      "rotation_flip": 0.007906497456133366,
      "sparse_tokens": 32073.0,
      "step": 973,
      "turn_loss": 0.1364089548587799,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.04525181193086787,
      "grad_norm": 0.7759588956832886,
      "learning_rate": 9.873333237791765e-06,
      "loss": 0.1415,
      "mae_dtheta": 0.0252415481954813,
      "mae_dx": 0.012006664648652077,
      "mae_dy": 0.0043731024488806725,
      "pose_mae_dtheta": 0.1922498196363449,
      "pose_mae_dx": 0.08898914605379105,
      "pose_mae_dy": 0.06317271292209625,
      "pose_rmse_dtheta": 0.3558596670627594,
      "pose_rmse_dx": 0.20185981690883636,
      "pose_rmse_dy": 0.15215624868869781,
      "pose_rmse_mean": 0.23662523925304413,
      "rmse_dtheta": 0.03981989249587059,
      "rmse_dx": 0.02426079474389553,
      "rmse_dy": 0.008494099602103233,
      "rmse_mean": 0.02419159561395645,
      "rotation_flip": 0.0139860138297081,
      "sparse_tokens": 13447.0,
      "step": 974,
      "turn_loss": 0.24523361027240753,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.04529827169671065,
      "grad_norm": 0.5713615417480469,
      "learning_rate": 9.873037336525424e-06,
      "loss": 0.1825,
      "mae_dtheta": 0.03161356598138809,
      "mae_dx": 0.009771260432898998,
      "mae_dy": 0.004505038261413574,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5713615417480469,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 143.5281219482422,
      "model/head/act_norm_mean": 100.43215110085227,
      "model/head/act_norm_min": 73.05158996582031,
      "model/head/act_over_embed": 69.01791449711833,
      "model/head/grad_frac": 0.10963063687086105,
      "model/head/grad_norm": 0.06263872981071472,
      "model/head/grad_zero_frac": 0.00020686119387391955,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6673029119318182,
      "model/head/update_ratio": 0.0010928086703643203,
      "model/head/weight_delta": 3.4737930297851562,
      "model/head/weight_delta_rel": 0.06094061955809593,
      "model/head/weight_norm": 57.319026947021484,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41135671734809875,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41130960252549914,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4112697243690491,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2826558095966913,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07219865918159485,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0412515364587307,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.53515625,
      "model/modality_embedder.encoders.pose/update_ratio": 0.00134443084243685,
      "model/modality_embedder.encoders.pose/weight_delta": 1.065132737159729,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.03480120748281479,
      "model/modality_embedder.encoders.pose/weight_norm": 30.683271408081055,
      "model/modality_embedder/grad_frac": 0.07219865918159485,
      "model/modality_embedder/grad_norm": 0.0412515364587307,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.53515625,
      "model/modality_embedder/update_ratio": 0.00134443084243685,
      "model/modality_embedder/weight_delta": 1.065132737159729,
      "model/modality_embedder/weight_delta_rel": 0.03480120748281479,
      "model/modality_embedder/weight_norm": 30.683271408081055,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.53841400146484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.39562195616883,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.096705436706543,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.390481079395396,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10165005177259445,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05807892978191376,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0021106284111738205,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.553747832775116,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.02017890475690365,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.517364501953125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.11351776123047,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.344784338924963,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.524641036987305,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.042754355023643,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10196048021316528,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.058256298303604126,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0020082148257642984,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.6682779788970947,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.023149671033024788,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.00899887084961,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 77.86239624023438,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.1232159767316,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.20058536529541,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.26490922646368,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10931979864835739,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06246112659573555,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002086677122861147,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.699471116065979,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.02348693087697029,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.933298110961914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.02046966552734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.09906543109668,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.103609085083008,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.6227314696974,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11788865178823471,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06735704094171524,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022933660075068474,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.5932074785232544,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.02027301676571369,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.370384216308594,
      "model/normalizer/grad_frac": 0.4496845006942749,
      "model/normalizer/grad_norm": 0.25693243741989136,
      "model/normalizer/grad_zero_frac": 0.00019380509911570698,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0033024062868207693,
      "model/normalizer/weight_delta": 1.295628547668457,
      "model/normalizer/weight_delta_rel": 0.016686946153640747,
      "model/normalizer/weight_norm": 77.80158233642578,
      "pose_mae_dtheta": 0.2664680480957031,
      "pose_mae_dx": 0.087461456656456,
      "pose_mae_dy": 0.0562666580080986,
      "pose_rmse_dtheta": 0.4710668921470642,
      "pose_rmse_dx": 0.20398177206516266,
      "pose_rmse_dy": 0.14054833352565765,
      "pose_rmse_mean": 0.2718656659126282,
      "rmse_dtheta": 0.04940751567482948,
      "rmse_dx": 0.020510442554950714,
      "rmse_dy": 0.009777081198990345,
      "rmse_mean": 0.02656501531600952,
      "rotation_flip": 0.015243902802467346,
      "sparse_tokens": 11365.0,
      "step": 975,
      "turn_loss": 0.23258152604103088,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.045344731462553425,
      "grad_norm": 0.5993773341178894,
      "learning_rate": 9.872741094484965e-06,
      "loss": 0.2153,
      "mae_dtheta": 0.028347112238407135,
      "mae_dx": 0.007825053296983242,
      "mae_dy": 0.00532279908657074,
      "pose_mae_dtheta": 0.20482325553894043,
      "pose_mae_dx": 0.06058035045862198,
      "pose_mae_dy": 0.06383443623781204,
      "pose_rmse_dtheta": 0.351705938577652,
      "pose_rmse_dx": 0.1441468745470047,
      "pose_rmse_dy": 0.13647599518299103,
      "pose_rmse_mean": 0.21077626943588257,
      "rmse_dtheta": 0.042185671627521515,
      "rmse_dx": 0.018428217619657516,
      "rmse_dy": 0.009116921573877335,
      "rmse_mean": 0.023243604227900505,
      "rotation_flip": 0.020592020824551582,
      "sparse_tokens": 13808.0,
      "step": 976,
      "turn_loss": 0.2591984272003174,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.04539119122839621,
      "grad_norm": 0.41219404339790344,
      "learning_rate": 9.872444511691108e-06,
      "loss": 0.0899,
      "mae_dtheta": 0.009501957334578037,
      "mae_dx": 0.001773207332007587,
      "mae_dy": 0.0014301356859505177,
      "pose_mae_dtheta": 0.07283849269151688,
      "pose_mae_dx": 0.020245106890797615,
      "pose_mae_dy": 0.023380057886242867,
      "pose_rmse_dtheta": 0.21198128163814545,
      "pose_rmse_dx": 0.048991575837135315,
      "pose_rmse_dy": 0.052334632724523544,
      "pose_rmse_mean": 0.10443583130836487,
      "rmse_dtheta": 0.02345084212720394,
      "rmse_dx": 0.005269488785415888,
      "rmse_dy": 0.0034692096523940563,
      "rmse_mean": 0.010729847475886345,
      "rotation_flip": 0.0037704231217503548,
      "sparse_tokens": 32121.0,
      "step": 977,
      "turn_loss": 0.06747332215309143,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.045437650994238986,
      "grad_norm": 0.8475412130355835,
      "learning_rate": 9.872147588164591e-06,
      "loss": 0.3345,
      "mae_dtheta": 0.03082316182553768,
      "mae_dx": 0.019375454634428024,
      "mae_dy": 0.005397440399974585,
      "pose_mae_dtheta": 0.23609818518161774,
      "pose_mae_dx": 0.1703900694847107,
      "pose_mae_dy": 0.07872407883405685,
      "pose_rmse_dtheta": 0.3878273069858551,
      "pose_rmse_dx": 0.3417581021785736,
      "pose_rmse_dy": 0.1643264889717102,
      "pose_rmse_mean": 0.29797065258026123,
      "rmse_dtheta": 0.0440799780189991,
      "rmse_dx": 0.03511057421565056,
      "rmse_dy": 0.00988014042377472,
      "rmse_mean": 0.029690232127904892,
      "rotation_flip": 0.012886597774922848,
      "sparse_tokens": 7713.0,
      "step": 978,
      "turn_loss": 0.26430225372314453,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.04548411076008177,
      "grad_norm": 0.7674100399017334,
      "learning_rate": 9.871850323926178e-06,
      "loss": 0.1177,
      "mae_dtheta": 0.009465929120779037,
      "mae_dx": 0.0024266387335956097,
      "mae_dy": 0.0009883936727419496,
      "pose_mae_dtheta": 0.07027701288461685,
      "pose_mae_dx": 0.02192506194114685,
      "pose_mae_dy": 0.014030290767550468,
      "pose_rmse_dtheta": 0.24824732542037964,
      "pose_rmse_dx": 0.05916218459606171,
      "pose_rmse_dy": 0.04233875870704651,
      "pose_rmse_mean": 0.11658276617527008,
      "rmse_dtheta": 0.026786286383867264,
      "rmse_dx": 0.007015778683125973,
      "rmse_dy": 0.0023596775718033314,
      "rmse_mean": 0.012053914368152618,
      "rotation_flip": 0.001325088320299983,
      "sparse_tokens": 32201.0,
      "step": 979,
      "turn_loss": 0.06488027423620224,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.045530570525924546,
      "grad_norm": 0.6642242074012756,
      "learning_rate": 9.871552718996656e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.009363931603729725,
      "mae_dx": 0.0025067098904401064,
      "mae_dy": 0.0022501300554722548,
      "pose_mae_dtheta": 0.06635569781064987,
      "pose_mae_dx": 0.033125028014183044,
      "pose_mae_dy": 0.028686391189694405,
      "pose_rmse_dtheta": 0.12865804135799408,
      "pose_rmse_dx": 0.07262977957725525,
      "pose_rmse_dy": 0.06809383630752563,
      "pose_rmse_mean": 0.08979388326406479,
      "rmse_dtheta": 0.018972793594002724,
      "rmse_dx": 0.006277544889599085,
      "rmse_dy": 0.005201568827033043,
      "rmse_mean": 0.010150635614991188,
      "rotation_flip": 0.00350330863147974,
      "sparse_tokens": 32185.0,
      "step": 980,
      "turn_loss": 0.09799661487340927,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.04557703029176733,
      "grad_norm": 0.5834904313087463,
      "learning_rate": 9.871254773396837e-06,
      "loss": 0.2088,
      "mae_dtheta": 0.03310104459524155,
      "mae_dx": 0.01575048826634884,
      "mae_dy": 0.006377047393471003,
      "pose_mae_dtheta": 0.2516336739063263,
      "pose_mae_dx": 0.12150248885154724,
      "pose_mae_dy": 0.08424241840839386,
      "pose_rmse_dtheta": 0.3981262743473053,
      "pose_rmse_dx": 0.2522337734699249,
      "pose_rmse_dy": 0.16713637113571167,
      "pose_rmse_mean": 0.27249881625175476,
      "rmse_dtheta": 0.04639642685651779,
      "rmse_dx": 0.028814584016799927,
      "rmse_dy": 0.011019427329301834,
      "rmse_mean": 0.028743481263518333,
      "rotation_flip": 0.00805523619055748,
      "sparse_tokens": 16061.0,
      "step": 981,
      "turn_loss": 0.33530211448669434,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.04562349005761011,
      "grad_norm": 0.58353191614151,
      "learning_rate": 9.870956487147558e-06,
      "loss": 0.152,
      "mae_dtheta": 0.027837585657835007,
      "mae_dx": 0.012639776803553104,
      "mae_dy": 0.0064883166924119,
      "pose_mae_dtheta": 0.24366013705730438,
      "pose_mae_dx": 0.09625667333602905,
      "pose_mae_dy": 0.09853240847587585,
      "pose_rmse_dtheta": 0.3905723989009857,
      "pose_rmse_dx": 0.1934157907962799,
      "pose_rmse_dy": 0.25597724318504333,
      "pose_rmse_mean": 0.27998849749565125,
      "rmse_dtheta": 0.04114902764558792,
      "rmse_dx": 0.022596653550863266,
      "rmse_dy": 0.013635828159749508,
      "rmse_mean": 0.025793835520744324,
      "rotation_flip": 0.017467249184846878,
      "sparse_tokens": 3469.0,
      "step": 982,
      "turn_loss": 0.25012868642807007,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 17860.0,
      "epoch": 0.04566994982345289,
      "grad_norm": 0.6468665599822998,
      "learning_rate": 9.870657860269678e-06,
      "loss": 0.1513,
      "mae_dtheta": 0.028262577950954437,
      "mae_dx": 0.010841777548193932,
      "mae_dy": 0.004502184689044952,
      "pose_mae_dtheta": 0.2243098020553589,
      "pose_mae_dx": 0.08211711049079895,
      "pose_mae_dy": 0.0548526756465435,
      "pose_rmse_dtheta": 0.431128591299057,
      "pose_rmse_dx": 0.22153958678245544,
      "pose_rmse_dy": 0.12329310178756714,
      "pose_rmse_mean": 0.25865375995635986,
      "rmse_dtheta": 0.045597534626722336,
      "rmse_dx": 0.024470606818795204,
      "rmse_dy": 0.008521600626409054,
      "rmse_mean": 0.02619658224284649,
      "rotation_flip": 0.008293839171528816,
      "sparse_tokens": 14103.0,
      "step": 983,
      "turn_loss": 0.2569640278816223,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.04571640958929567,
      "grad_norm": 0.5313541889190674,
      "learning_rate": 9.870358892784078e-06,
      "loss": 0.1088,
      "mae_dtheta": 0.012710832059383392,
      "mae_dx": 0.002710282104089856,
      "mae_dy": 0.0033497693948447704,
      "pose_mae_dtheta": 0.09240350872278214,
      "pose_mae_dx": 0.034684114158153534,
      "pose_mae_dy": 0.037699390202760696,
      "pose_rmse_dtheta": 0.21643872559070587,
      "pose_rmse_dx": 0.08550447970628738,
      "pose_rmse_dy": 0.084540955722332,
      "pose_rmse_mean": 0.12882806360721588,
      "rmse_dtheta": 0.026067297905683517,
      "rmse_dx": 0.007930826395750046,
      "rmse_dy": 0.007187913171947002,
      "rmse_mean": 0.013728680089116096,
      "rotation_flip": 0.005553498864173889,
      "sparse_tokens": 32105.0,
      "step": 984,
      "turn_loss": 0.09777899831533432,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.04576286935513845,
      "grad_norm": 0.784674882888794,
      "learning_rate": 9.870059584711668e-06,
      "loss": 0.1231,
      "mae_dtheta": 0.03543081134557724,
      "mae_dx": 0.011176268570125103,
      "mae_dy": 0.00295520038343966,
      "pose_mae_dtheta": 0.2693274915218353,
      "pose_mae_dx": 0.09586954861879349,
      "pose_mae_dy": 0.03142349794507027,
      "pose_rmse_dtheta": 0.5171182155609131,
      "pose_rmse_dx": 0.22225560247898102,
      "pose_rmse_dy": 0.06812497228384018,
      "pose_rmse_mean": 0.2691662609577179,
      "rmse_dtheta": 0.057481877505779266,
      "rmse_dx": 0.02332298457622528,
      "rmse_dy": 0.005875794682651758,
      "rmse_mean": 0.028893552720546722,
      "rotation_flip": 0.018416205421090126,
      "sparse_tokens": 8317.0,
      "step": 985,
      "turn_loss": 0.23893451690673828,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.04580932912098123,
      "grad_norm": 0.6541873216629028,
      "learning_rate": 9.869759936073377e-06,
      "loss": 0.1312,
      "mae_dtheta": 0.013514762744307518,
      "mae_dx": 0.0025235034991055727,
      "mae_dy": 0.0026028137654066086,
      "pose_mae_dtheta": 0.10313673317432404,
      "pose_mae_dx": 0.025835497304797173,
      "pose_mae_dy": 0.03378617390990257,
      "pose_rmse_dtheta": 0.2772274613380432,
      "pose_rmse_dx": 0.06567452102899551,
      "pose_rmse_dy": 0.10748867690563202,
      "pose_rmse_mean": 0.15013021230697632,
      "rmse_dtheta": 0.030878860503435135,
      "rmse_dx": 0.007280060555785894,
      "rmse_dy": 0.007510453462600708,
      "rmse_mean": 0.015223124995827675,
      "rotation_flip": 0.003859513672068715,
      "sparse_tokens": 32121.0,
      "step": 986,
      "turn_loss": 0.11584214121103287,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.04585578888682401,
      "grad_norm": 0.4990120828151703,
      "learning_rate": 9.869459946890162e-06,
      "loss": 0.1477,
      "mae_dtheta": 0.035808417946100235,
      "mae_dx": 0.012076116167008877,
      "mae_dy": 0.007076608948409557,
      "pose_mae_dtheta": 0.2967382073402405,
      "pose_mae_dx": 0.11885099112987518,
      "pose_mae_dy": 0.08419228345155716,
      "pose_rmse_dtheta": 0.5011706948280334,
      "pose_rmse_dx": 0.27844393253326416,
      "pose_rmse_dy": 0.1611655354499817,
      "pose_rmse_mean": 0.31359338760375977,
      "rmse_dtheta": 0.05287475138902664,
      "rmse_dx": 0.02545049972832203,
      "rmse_dy": 0.015156715176999569,
      "rmse_mean": 0.031160656362771988,
      "rotation_flip": 0.018018018454313278,
      "sparse_tokens": 8979.0,
      "step": 987,
      "turn_loss": 0.28911399841308594,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.04590224865266679,
      "grad_norm": 0.4660152196884155,
      "learning_rate": 9.869159617182995e-06,
      "loss": 0.1379,
      "mae_dtheta": 0.027625268325209618,
      "mae_dx": 0.008642570115625858,
      "mae_dy": 0.00979745201766491,
      "pose_mae_dtheta": 0.2294919490814209,
      "pose_mae_dx": 0.07464026659727097,
      "pose_mae_dy": 0.15861743688583374,
      "pose_rmse_dtheta": 0.3651667535305023,
      "pose_rmse_dx": 0.14084047079086304,
      "pose_rmse_dy": 0.2624731957912445,
      "pose_rmse_mean": 0.2561601400375366,
      "rmse_dtheta": 0.04062461480498314,
      "rmse_dx": 0.019426649436354637,
      "rmse_dy": 0.013788045383989811,
      "rmse_mean": 0.02461310289800167,
      "rotation_flip": 0.010362694039940834,
      "sparse_tokens": 3382.0,
      "step": 988,
      "turn_loss": 0.2769698202610016,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04594870841850957,
      "grad_norm": 0.6276839375495911,
      "learning_rate": 9.868858946972886e-06,
      "loss": 0.1412,
      "mae_dtheta": 0.00966564193367958,
      "mae_dx": 0.0017172503285109997,
      "mae_dy": 0.002034880453720689,
      "pose_mae_dtheta": 0.06816517561674118,
      "pose_mae_dx": 0.024388568475842476,
      "pose_mae_dy": 0.029099993407726288,
      "pose_rmse_dtheta": 0.1559373289346695,
      "pose_rmse_dx": 0.062087640166282654,
      "pose_rmse_dy": 0.0835053101181984,
      "pose_rmse_mean": 0.10051009058952332,
      "rmse_dtheta": 0.021347463130950928,
      "rmse_dx": 0.005249388981610537,
      "rmse_dy": 0.004626244772225618,
      "rmse_mean": 0.010407699272036552,
      "rotation_flip": 0.0036697247996926308,
      "sparse_tokens": 32089.0,
      "step": 989,
      "turn_loss": 0.07891667634248734,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.04599516818435235,
      "grad_norm": 0.6144639849662781,
      "learning_rate": 9.868557936280856e-06,
      "loss": 0.0898,
      "mae_dtheta": 0.004873331170529127,
      "mae_dx": 0.0018266424303874373,
      "mae_dy": 0.0009528417722322047,
      "pose_mae_dtheta": 0.036319028586149216,
      "pose_mae_dx": 0.016366269439458847,
      "pose_mae_dy": 0.012213894166052341,
      "pose_rmse_dtheta": 0.09960257261991501,
      "pose_rmse_dx": 0.050352148711681366,
      "pose_rmse_dy": 0.046161893755197525,
      "pose_rmse_mean": 0.06537220627069473,
      "rmse_dtheta": 0.013469968922436237,
      "rmse_dx": 0.005810070317238569,
      "rmse_dy": 0.002379950135946274,
      "rmse_mean": 0.007219996303319931,
      "rotation_flip": 0.0016806722851470113,
      "sparse_tokens": 32073.0,
      "step": 990,
      "turn_loss": 0.04530443251132965,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.04604162795019513,
      "grad_norm": 0.5103955864906311,
      "learning_rate": 9.868256585127956e-06,
      "loss": 0.1267,
      "mae_dtheta": 0.011654414236545563,
      "mae_dx": 0.0025278415996581316,
      "mae_dy": 0.002265521325170994,
      "pose_mae_dtheta": 0.08345913887023926,
      "pose_mae_dx": 0.02755727805197239,
      "pose_mae_dy": 0.0278908833861351,
      "pose_rmse_dtheta": 0.2042117863893509,
      "pose_rmse_dx": 0.07319654524326324,
      "pose_rmse_dy": 0.07711653411388397,
      "pose_rmse_mean": 0.1181749552488327,
      "rmse_dtheta": 0.02640150487422943,
      "rmse_dx": 0.007449087221175432,
      "rmse_dy": 0.005870026536285877,
      "rmse_mean": 0.013240206055343151,
      "rotation_flip": 0.0037209303118288517,
      "sparse_tokens": 32121.0,
      "step": 991,
      "turn_loss": 0.08668743818998337,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.04608808771603791,
      "grad_norm": 0.3728751242160797,
      "learning_rate": 9.867954893535261e-06,
      "loss": 0.0793,
      "mae_dtheta": 0.03364600986242294,
      "mae_dx": 0.017144806683063507,
      "mae_dy": 0.005241129081696272,
      "pose_mae_dtheta": 0.2804142236709595,
      "pose_mae_dx": 0.1520194709300995,
      "pose_mae_dy": 0.06286005675792694,
      "pose_rmse_dtheta": 0.4474811553955078,
      "pose_rmse_dx": 0.31722408533096313,
      "pose_rmse_dy": 0.11256635934114456,
      "pose_rmse_mean": 0.29242387413978577,
      "rmse_dtheta": 0.04666902497410774,
      "rmse_dx": 0.03050624020397663,
      "rmse_dy": 0.008485477417707443,
      "rmse_mean": 0.02855358086526394,
      "rotation_flip": 0.0357142873108387,
      "sparse_tokens": 3375.0,
      "step": 992,
      "turn_loss": 0.23448961973190308,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.04613454748188069,
      "grad_norm": 0.578111469745636,
      "learning_rate": 9.867652861523866e-06,
      "loss": 0.1444,
      "mae_dtheta": 0.014545144513249397,
      "mae_dx": 0.002758632181212306,
      "mae_dy": 0.0035528268199414015,
      "pose_mae_dtheta": 0.09800422936677933,
      "pose_mae_dx": 0.03670976310968399,
      "pose_mae_dy": 0.038689371198415756,
      "pose_rmse_dtheta": 0.2195812463760376,
      "pose_rmse_dx": 0.08349864929914474,
      "pose_rmse_dy": 0.0907941684126854,
      "pose_rmse_mean": 0.13129135966300964,
      "rmse_dtheta": 0.027548637241125107,
      "rmse_dx": 0.007667329628020525,
      "rmse_dy": 0.00734868785366416,
      "rmse_mean": 0.014188217930495739,
      "rotation_flip": 0.004952129442244768,
      "sparse_tokens": 32121.0,
      "step": 993,
      "turn_loss": 0.11500939726829529,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.04618100724772347,
      "grad_norm": 0.5814314484596252,
      "learning_rate": 9.867350489114896e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.03502136096358299,
      "mae_dx": 0.010981026105582714,
      "mae_dy": 0.006316630635410547,
      "pose_mae_dtheta": 0.27054402232170105,
      "pose_mae_dx": 0.09377910941839218,
      "pose_mae_dy": 0.07548709958791733,
      "pose_rmse_dtheta": 0.4993222951889038,
      "pose_rmse_dx": 0.1857977956533432,
      "pose_rmse_dy": 0.15174177289009094,
      "pose_rmse_mean": 0.2789539694786072,
      "rmse_dtheta": 0.0557178258895874,
      "rmse_dx": 0.021952947601675987,
      "rmse_dy": 0.01072720903903246,
      "rmse_mean": 0.029465995728969574,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 3169.0,
      "step": 994,
      "turn_loss": 0.2937436103820801,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.046227467013566254,
      "grad_norm": 0.4930705428123474,
      "learning_rate": 9.867047776329492e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.011683273129165173,
      "mae_dx": 0.0035308541264384985,
      "mae_dy": 0.002434946596622467,
      "pose_mae_dtheta": 0.08227021992206573,
      "pose_mae_dx": 0.025918932631611824,
      "pose_mae_dy": 0.015958812087774277,
      "pose_rmse_dtheta": 0.253545880317688,
      "pose_rmse_dx": 0.06610894948244095,
      "pose_rmse_dy": 0.05578089505434036,
      "pose_rmse_mean": 0.12514524161815643,
      "rmse_dtheta": 0.0326259583234787,
      "rmse_dx": 0.00978022813796997,
      "rmse_dy": 0.00920595321804285,
      "rmse_mean": 0.01720404624938965,
      "rotation_flip": 0.006692694034427404,
      "sparse_tokens": 32185.0,
      "step": 995,
      "turn_loss": 0.1351020634174347,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04627392677940903,
      "grad_norm": 0.4578720033168793,
      "learning_rate": 9.866744723188826e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.008829928934574127,
      "mae_dx": 0.0017336831660941243,
      "mae_dy": 0.0020435848273336887,
      "pose_mae_dtheta": 0.06333113461732864,
      "pose_mae_dx": 0.0210381131619215,
      "pose_mae_dy": 0.02478756755590439,
      "pose_rmse_dtheta": 0.17861229181289673,
      "pose_rmse_dx": 0.05581348389387131,
      "pose_rmse_dy": 0.0609796941280365,
      "pose_rmse_mean": 0.09846849739551544,
      "rmse_dtheta": 0.021778656169772148,
      "rmse_dx": 0.005102311260998249,
      "rmse_dy": 0.005107726901769638,
      "rmse_mean": 0.010662898421287537,
      "rotation_flip": 0.006429277826100588,
      "sparse_tokens": 32089.0,
      "step": 996,
      "turn_loss": 0.07302166521549225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.046320386545251814,
      "grad_norm": 0.5695977210998535,
      "learning_rate": 9.86644132971409e-06,
      "loss": 0.0947,
      "mae_dtheta": 0.01154838502407074,
      "mae_dx": 0.0017497256631031632,
      "mae_dy": 0.0015813747886568308,
      "pose_mae_dtheta": 0.08838906139135361,
      "pose_mae_dx": 0.021890616044402122,
      "pose_mae_dy": 0.029245922341942787,
      "pose_rmse_dtheta": 0.24556073546409607,
      "pose_rmse_dx": 0.04623842611908913,
      "pose_rmse_dy": 0.068791963160038,
      "pose_rmse_mean": 0.12019704282283783,
      "rmse_dtheta": 0.02769082598388195,
      "rmse_dx": 0.0053273653611540794,
      "rmse_dy": 0.0031491064000874758,
      "rmse_mean": 0.012055765837430954,
      "rotation_flip": 0.0023771789856255054,
      "sparse_tokens": 32153.0,
      "step": 997,
      "turn_loss": 0.08789007365703583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.04636684631109459,
      "grad_norm": 1.1839289665222168,
      "learning_rate": 9.866137595926498e-06,
      "loss": 0.2514,
      "mae_dtheta": 0.01999153569340706,
      "mae_dx": 0.00537700904533267,
      "mae_dy": 0.009922298602759838,
      "pose_mae_dtheta": 0.1587998867034912,
      "pose_mae_dx": 0.07179774343967438,
      "pose_mae_dy": 0.09220443665981293,
      "pose_rmse_dtheta": 0.3214725852012634,
      "pose_rmse_dx": 0.18180377781391144,
      "pose_rmse_dy": 0.2106246054172516,
      "pose_rmse_mean": 0.23796698451042175,
      "rmse_dtheta": 0.033970966935157776,
      "rmse_dx": 0.012674225494265556,
      "rmse_dy": 0.019803673028945923,
      "rmse_mean": 0.022149622440338135,
      "rotation_flip": 0.005936675239354372,
      "sparse_tokens": 32057.0,
      "step": 998,
      "turn_loss": 0.25978928804397583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.046413306076937375,
      "grad_norm": 0.5918570756912231,
      "learning_rate": 9.865833521847292e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.040030911564826965,
      "mae_dx": 0.01142356637865305,
      "mae_dy": 0.0038887050468474627,
      "pose_mae_dtheta": 0.3432472348213196,
      "pose_mae_dx": 0.08584347367286682,
      "pose_mae_dy": 0.05076124146580696,
      "pose_rmse_dtheta": 0.5583592653274536,
      "pose_rmse_dx": 0.18788757920265198,
      "pose_rmse_dy": 0.12518329918384552,
      "pose_rmse_mean": 0.2904767096042633,
      "rmse_dtheta": 0.05772431194782257,
      "rmse_dx": 0.022702859714627266,
      "rmse_dy": 0.007810994051396847,
      "rmse_mean": 0.02941272221505642,
      "rotation_flip": 0.007894736714661121,
      "sparse_tokens": 13245.0,
      "step": 999,
      "turn_loss": 0.3042755126953125,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.04645976584278015,
      "grad_norm": 0.5546748042106628,
      "learning_rate": 9.865529107497737e-06,
      "loss": 0.1263,
      "mae_dtheta": 0.04107383266091347,
      "mae_dx": 0.012385154142975807,
      "mae_dy": 0.005952773615717888,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5546749234199524,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 141.76939392089844,
      "model/head/act_norm_mean": 93.71043836805555,
      "model/head/act_norm_min": 63.502960205078125,
      "model/head/act_over_embed": 64.39869057747435,
      "model/head/grad_frac": 0.10049506276845932,
      "model/head/grad_norm": 0.05574209243059158,
      "model/head/grad_zero_frac": 0.00019924667140003294,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6829861111111111,
      "model/head/update_ratio": 0.0009723284747451544,
      "model/head/weight_delta": 3.517641544342041,
      "model/head/weight_delta_rel": 0.061709851026535034,
      "model/head/weight_norm": 57.32845687866211,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4114745855331421,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4114279954329781,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41137444972991943,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28273717031112267,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10663115978240967,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05914562940597534,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5281080163043478,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019274657825008035,
      "model/modality_embedder.encoders.pose/weight_delta": 1.084870457649231,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.03544609993696213,
      "model/modality_embedder.encoders.pose/weight_norm": 30.68569564819336,
      "model/modality_embedder/grad_frac": 0.10663115978240967,
      "model/modality_embedder/grad_norm": 0.05914562940597534,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5281080163043478,
      "model/modality_embedder/update_ratio": 0.0019274657825008035,
      "model/modality_embedder/weight_delta": 1.084870457649231,
      "model/modality_embedder/weight_delta_rel": 0.03544609993696213,
      "model/modality_embedder/weight_norm": 30.68569564819336,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.28582763671875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.847194664902997,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.032916069030762,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.01359671038032,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08222485333681107,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04560806602239609,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016572882886976004,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.5650533437728882,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.02059088461101055,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.51969337463379,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.74777221679688,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.78132991622575,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.689109802246094,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.655543200601327,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08494285494089127,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04711567237973213,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016239398391917348,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.683914065361023,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.023691317066550255,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.013187408447266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.69579315185547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.527579365079365,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.1570405960083,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.855582170498447,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09144814312458038,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05072399228811264,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016943439841270447,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.7156094312667847,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.024028824642300606,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.937246322631836,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.69104766845703,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.516030092592594,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.541654586791992,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.22206412661455,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10244248807430267,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0568222776055336,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001934480620548129,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.6063210964202881,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.020721178501844406,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.373401641845703,
      "model/normalizer/grad_frac": 0.3386763632297516,
      "model/normalizer/grad_norm": 0.1878552883863449,
      "model/normalizer/grad_zero_frac": 0.0002068042231258005,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0024144076742231846,
      "model/normalizer/weight_delta": 1.3245128393173218,
      "model/normalizer/weight_delta_rel": 0.0170589592307806,
      "model/normalizer/weight_norm": 77.80595397949219,
      "pose_mae_dtheta": 0.3089316785335541,
      "pose_mae_dx": 0.11235189437866211,
      "pose_mae_dy": 0.06697199493646622,
      "pose_rmse_dtheta": 0.5262705087661743,
      "pose_rmse_dx": 0.2455875277519226,
      "pose_rmse_dy": 0.17341069877147675,
      "pose_rmse_mean": 0.3150895833969116,
      "rmse_dtheta": 0.06045209616422653,
      "rmse_dx": 0.025283783674240112,
      "rmse_dy": 0.01284861471503973,
      "rmse_mean": 0.03286150097846985,
      "rotation_flip": 0.009655172005295753,
      "sparse_tokens": 11702.0,
      "step": 1000,
      "turn_loss": 0.3138461709022522,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "epoch": 0.04645976584278015,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.33721601963043213,
      "eval_objectnav_nopose_mae_dtheta": 0.04325787350535393,
      "eval_objectnav_nopose_mae_dx": 0.01492398977279663,
      "eval_objectnav_nopose_mae_dy": 0.0059021092019975185,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3577703833580017,
      "eval_objectnav_nopose_pose_mae_dx": 0.12372773140668869,
      "eval_objectnav_nopose_pose_mae_dy": 0.06865646690130234,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5836659073829651,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2574760615825653,
      "eval_objectnav_nopose_pose_rmse_dy": 0.15736398100852966,
      "eval_objectnav_nopose_pose_rmse_mean": 0.33283531665802,
      "eval_objectnav_nopose_rmse_dtheta": 0.06086904555559158,
      "eval_objectnav_nopose_rmse_dx": 0.027935674414038658,
      "eval_objectnav_nopose_rmse_dy": 0.01195953506976366,
      "eval_objectnav_nopose_rmse_mean": 0.03358808904886246,
      "eval_objectnav_nopose_rotation_flip": 0.014752350747585297,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.33721601963043213,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 1000
    },
    {
      "epoch": 0.04645976584278015,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.30150899291038513,
      "eval_objectnav_pose_mae_dtheta": 0.03787263482809067,
      "eval_objectnav_pose_mae_dx": 0.012094120495021343,
      "eval_objectnav_pose_mae_dy": 0.005385654978454113,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2924642860889435,
      "eval_objectnav_pose_pose_mae_dx": 0.09467396885156631,
      "eval_objectnav_pose_pose_mae_dy": 0.06065339967608452,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5027798414230347,
      "eval_objectnav_pose_pose_rmse_dx": 0.21359312534332275,
      "eval_objectnav_pose_pose_rmse_dy": 0.1454438716173172,
      "eval_objectnav_pose_pose_rmse_mean": 0.28727227449417114,
      "eval_objectnav_pose_rmse_dtheta": 0.055848438292741776,
      "eval_objectnav_pose_rmse_dx": 0.024506760761141777,
      "eval_objectnav_pose_rmse_dy": 0.011103330180048943,
      "eval_objectnav_pose_rmse_mean": 0.030486177653074265,
      "eval_objectnav_pose_rotation_flip": 0.014039356261491776,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.30150899291038513,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 1000
    },
    {
      "epoch": 0.04645976584278015,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.11540931463241577,
      "eval_pointnav_mae_dtheta": 0.013319755904376507,
      "eval_pointnav_mae_dx": 0.003199364058673382,
      "eval_pointnav_mae_dy": 0.0031676481012254953,
      "eval_pointnav_pose_mae_dtheta": 0.09682319313287735,
      "eval_pointnav_pose_mae_dx": 0.037077754735946655,
      "eval_pointnav_pose_mae_dy": 0.036478035151958466,
      "eval_pointnav_pose_rmse_dtheta": 0.2459525763988495,
      "eval_pointnav_pose_rmse_dx": 0.09875614196062088,
      "eval_pointnav_pose_rmse_dy": 0.10400993376970291,
      "eval_pointnav_pose_rmse_mean": 0.14957287907600403,
      "eval_pointnav_rmse_dtheta": 0.029420925304293633,
      "eval_pointnav_rmse_dx": 0.009123480878770351,
      "eval_pointnav_rmse_dy": 0.008054456673562527,
      "eval_pointnav_rmse_mean": 0.015532954595983028,
      "eval_pointnav_rotation_flip": 0.005220264662057161,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.11540931463241577,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 1000
    },
    {
      "epoch": 0.04645976584278015,
      "eval_loss": 0.2513781090577443,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.33721601963043213,
      "eval_objectnav_nopose_mae_dtheta": 0.04325787350535393,
      "eval_objectnav_nopose_mae_dx": 0.01492398977279663,
      "eval_objectnav_nopose_mae_dy": 0.0059021092019975185,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3577703833580017,
      "eval_objectnav_nopose_pose_mae_dx": 0.12372773140668869,
      "eval_objectnav_nopose_pose_mae_dy": 0.06865646690130234,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5836659073829651,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2574760615825653,
      "eval_objectnav_nopose_pose_rmse_dy": 0.15736398100852966,
      "eval_objectnav_nopose_pose_rmse_mean": 0.33283531665802,
      "eval_objectnav_nopose_rmse_dtheta": 0.06086904555559158,
      "eval_objectnav_nopose_rmse_dx": 0.027935674414038658,
      "eval_objectnav_nopose_rmse_dy": 0.01195953506976366,
      "eval_objectnav_nopose_rmse_mean": 0.03358808904886246,
      "eval_objectnav_nopose_rotation_flip": 0.014752350747585297,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.33721601963043213,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.30150899291038513,
      "eval_objectnav_pose_mae_dtheta": 0.03787263482809067,
      "eval_objectnav_pose_mae_dx": 0.012094120495021343,
      "eval_objectnav_pose_mae_dy": 0.005385654978454113,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2924642860889435,
      "eval_objectnav_pose_pose_mae_dx": 0.09467396885156631,
      "eval_objectnav_pose_pose_mae_dy": 0.06065339967608452,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5027798414230347,
      "eval_objectnav_pose_pose_rmse_dx": 0.21359312534332275,
      "eval_objectnav_pose_pose_rmse_dy": 0.1454438716173172,
      "eval_objectnav_pose_pose_rmse_mean": 0.28727227449417114,
      "eval_objectnav_pose_rmse_dtheta": 0.055848438292741776,
      "eval_objectnav_pose_rmse_dx": 0.024506760761141777,
      "eval_objectnav_pose_rmse_dy": 0.011103330180048943,
      "eval_objectnav_pose_rmse_mean": 0.030486177653074265,
      "eval_objectnav_pose_rotation_flip": 0.014039356261491776,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.30150899291038513,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.11540931463241577,
      "eval_pointnav_mae_dtheta": 0.013319755904376507,
      "eval_pointnav_mae_dx": 0.003199364058673382,
      "eval_pointnav_mae_dy": 0.0031676481012254953,
      "eval_pointnav_pose_mae_dtheta": 0.09682319313287735,
      "eval_pointnav_pose_mae_dx": 0.037077754735946655,
      "eval_pointnav_pose_mae_dy": 0.036478035151958466,
      "eval_pointnav_pose_rmse_dtheta": 0.2459525763988495,
      "eval_pointnav_pose_rmse_dx": 0.09875614196062088,
      "eval_pointnav_pose_rmse_dy": 0.10400993376970291,
      "eval_pointnav_pose_rmse_mean": 0.14957287907600403,
      "eval_pointnav_rmse_dtheta": 0.029420925304293633,
      "eval_pointnav_rmse_dx": 0.009123480878770351,
      "eval_pointnav_rmse_dy": 0.008054456673562527,
      "eval_pointnav_rmse_mean": 0.015532954595983028,
      "eval_pointnav_rotation_flip": 0.005220264662057161,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.11540931463241577,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 1000
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.046506225608622935,
      "grad_norm": 0.6262458562850952,
      "learning_rate": 9.86522435289912e-06,
      "loss": 0.1055,
      "mae_dtheta": 0.012445878237485886,
      "mae_dx": 0.0025164526887238026,
      "mae_dy": 0.00239230296574533,
      "pose_mae_dtheta": 0.09728735685348511,
      "pose_mae_dx": 0.03046794980764389,
      "pose_mae_dy": 0.03637490049004555,
      "pose_rmse_dtheta": 0.21080200374126434,
      "pose_rmse_dx": 0.07760675251483917,
      "pose_rmse_dy": 0.08936122059822083,
      "pose_rmse_mean": 0.12592333555221558,
      "rmse_dtheta": 0.02516498789191246,
      "rmse_dx": 0.007799989078193903,
      "rmse_dy": 0.005178232677280903,
      "rmse_mean": 0.012714403681457043,
      "rotation_flip": 0.003466204507276416,
      "sparse_tokens": 32105.0,
      "step": 1001,
      "turn_loss": 0.10555101931095123,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04655268537446571,
      "grad_norm": 0.861497163772583,
      "learning_rate": 9.864919258072753e-06,
      "loss": 0.1436,
      "mae_dtheta": 0.016196561977267265,
      "mae_dx": 0.00486899446696043,
      "mae_dy": 0.005530699156224728,
      "pose_mae_dtheta": 0.11938925087451935,
      "pose_mae_dx": 0.05663890764117241,
      "pose_mae_dy": 0.05991489812731743,
      "pose_rmse_dtheta": 0.26858583092689514,
      "pose_rmse_dx": 0.14078521728515625,
      "pose_rmse_dy": 0.1355416178703308,
      "pose_rmse_mean": 0.18163757026195526,
      "rmse_dtheta": 0.031176190823316574,
      "rmse_dx": 0.012930886819958687,
      "rmse_dy": 0.012791774235665798,
      "rmse_mean": 0.01896628551185131,
      "rotation_flip": 0.008501593954861164,
      "sparse_tokens": 32089.0,
      "step": 1002,
      "turn_loss": 0.16250768303871155,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.046599145140308496,
      "grad_norm": 0.7961965203285217,
      "learning_rate": 9.864613823039971e-06,
      "loss": 0.149,
      "mae_dtheta": 0.036592960357666016,
      "mae_dx": 0.006427403539419174,
      "mae_dy": 0.0037956482265144587,
      "pose_mae_dtheta": 0.2982386350631714,
      "pose_mae_dx": 0.05557665228843689,
      "pose_mae_dy": 0.04027404636144638,
      "pose_rmse_dtheta": 0.5789921879768372,
      "pose_rmse_dx": 0.12560303509235382,
      "pose_rmse_dy": 0.09436839073896408,
      "pose_rmse_mean": 0.26632121205329895,
      "rmse_dtheta": 0.059149812906980515,
      "rmse_dx": 0.014979660511016846,
      "rmse_dy": 0.008601813577115536,
      "rmse_mean": 0.027577098459005356,
      "rotation_flip": 0.010507880710065365,
      "sparse_tokens": 8999.0,
      "step": 1003,
      "turn_loss": 0.2011760026216507,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.04664560490615127,
      "grad_norm": 0.6494815945625305,
      "learning_rate": 9.864308047822133e-06,
      "loss": 0.1477,
      "mae_dtheta": 0.025750912725925446,
      "mae_dx": 0.017191728577017784,
      "mae_dy": 0.007057814858853817,
      "pose_mae_dtheta": 0.21968619525432587,
      "pose_mae_dx": 0.0922698825597763,
      "pose_mae_dy": 0.1005580872297287,
      "pose_rmse_dtheta": 0.34598615765571594,
      "pose_rmse_dx": 0.20989428460597992,
      "pose_rmse_dy": 0.2176472693681717,
      "pose_rmse_mean": 0.2578425705432892,
      "rmse_dtheta": 0.03725270926952362,
      "rmse_dx": 0.03077763319015503,
      "rmse_dy": 0.01304206345230341,
      "rmse_mean": 0.02702413499355316,
      "rotation_flip": 0.014044944196939468,
      "sparse_tokens": 5889.0,
      "step": 1004,
      "turn_loss": 0.23528781533241272,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 12636.0,
      "epoch": 0.046692064671994056,
      "grad_norm": 0.5493620038032532,
      "learning_rate": 9.864001932440621e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.039898719638586044,
      "mae_dx": 0.012336384505033493,
      "mae_dy": 0.007794047240167856,
      "pose_mae_dtheta": 0.3209221065044403,
      "pose_mae_dx": 0.09928765892982483,
      "pose_mae_dy": 0.12545020878314972,
      "pose_rmse_dtheta": 0.5912447571754456,
      "pose_rmse_dx": 0.224177747964859,
      "pose_rmse_dy": 0.2545470893383026,
      "pose_rmse_mean": 0.356656551361084,
      "rmse_dtheta": 0.060247715562582016,
      "rmse_dx": 0.025670958682894707,
      "rmse_dy": 0.015266342088580132,
      "rmse_mean": 0.03372833877801895,
      "rotation_flip": 0.011406844481825829,
      "sparse_tokens": 10067.0,
      "step": 1005,
      "turn_loss": 0.3381240665912628,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.04673852443783683,
      "grad_norm": 0.6854982972145081,
      "learning_rate": 9.863695476916846e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.03389354422688484,
      "mae_dx": 0.018085045740008354,
      "mae_dy": 0.008242792449891567,
      "pose_mae_dtheta": 0.25691157579421997,
      "pose_mae_dx": 0.14898483455181122,
      "pose_mae_dy": 0.09317536652088165,
      "pose_rmse_dtheta": 0.42235469818115234,
      "pose_rmse_dx": 0.30067598819732666,
      "pose_rmse_dy": 0.21885870397090912,
      "pose_rmse_mean": 0.3139631450176239,
      "rmse_dtheta": 0.04834309220314026,
      "rmse_dx": 0.030968375504016876,
      "rmse_dy": 0.018428927287459373,
      "rmse_mean": 0.03258013352751732,
      "rotation_flip": 0.02064516209065914,
      "sparse_tokens": 13657.0,
      "step": 1006,
      "turn_loss": 0.35453498363494873,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.046784984203679617,
      "grad_norm": 0.5874391198158264,
      "learning_rate": 9.863388681272235e-06,
      "loss": 0.2046,
      "mae_dtheta": 0.03684597462415695,
      "mae_dx": 0.01648039184510708,
      "mae_dy": 0.008181308396160603,
      "pose_mae_dtheta": 0.303097665309906,
      "pose_mae_dx": 0.14084166288375854,
      "pose_mae_dy": 0.10133727639913559,
      "pose_rmse_dtheta": 0.4989272654056549,
      "pose_rmse_dx": 0.27648818492889404,
      "pose_rmse_dy": 0.2012573629617691,
      "pose_rmse_mean": 0.3255575895309448,
      "rmse_dtheta": 0.05271487310528755,
      "rmse_dx": 0.029697556048631668,
      "rmse_dy": 0.013783877715468407,
      "rmse_mean": 0.032065436244010925,
      "rotation_flip": 0.014895057305693626,
      "sparse_tokens": 22255.0,
      "step": 1007,
      "turn_loss": 0.37154582142829895,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.04683144396952239,
      "grad_norm": 0.561484694480896,
      "learning_rate": 9.863081545528241e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.02541099116206169,
      "mae_dx": 0.010981552302837372,
      "mae_dy": 0.0069628614000976086,
      "pose_mae_dtheta": 0.18095681071281433,
      "pose_mae_dx": 0.09046705812215805,
      "pose_mae_dy": 0.09015489369630814,
      "pose_rmse_dtheta": 0.3088487982749939,
      "pose_rmse_dx": 0.2133336365222931,
      "pose_rmse_dy": 0.1831146478652954,
      "pose_rmse_mean": 0.23509904742240906,
      "rmse_dtheta": 0.03860381245613098,
      "rmse_dx": 0.02400270290672779,
      "rmse_dy": 0.011436165310442448,
      "rmse_mean": 0.02468089386820793,
      "rotation_flip": 0.010600706562399864,
      "sparse_tokens": 20705.0,
      "step": 1008,
      "turn_loss": 0.24734972417354584,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.04687790373536518,
      "grad_norm": 0.4739401340484619,
      "learning_rate": 9.862774069706346e-06,
      "loss": 0.1447,
      "mae_dtheta": 0.013110881671309471,
      "mae_dx": 0.0022574944887310266,
      "mae_dy": 0.003063345327973366,
      "pose_mae_dtheta": 0.09104689210653305,
      "pose_mae_dx": 0.03208731859922409,
      "pose_mae_dy": 0.04092646390199661,
      "pose_rmse_dtheta": 0.19465802609920502,
      "pose_rmse_dx": 0.08738353103399277,
      "pose_rmse_dy": 0.09062190353870392,
      "pose_rmse_mean": 0.12422114610671997,
      "rmse_dtheta": 0.024659771472215652,
      "rmse_dx": 0.0067263999953866005,
      "rmse_dy": 0.006338905077427626,
      "rmse_mean": 0.012575025670230389,
      "rotation_flip": 0.008087201043963432,
      "sparse_tokens": 32105.0,
      "step": 1009,
      "turn_loss": 0.1124175414443016,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.046924363501207954,
      "grad_norm": 0.8213004469871521,
      "learning_rate": 9.862466253828052e-06,
      "loss": 0.2142,
      "mae_dtheta": 0.026614811271429062,
      "mae_dx": 0.014569776132702827,
      "mae_dy": 0.007139388006180525,
      "pose_mae_dtheta": 0.1709539294242859,
      "pose_mae_dx": 0.12111478298902512,
      "pose_mae_dy": 0.09755925834178925,
      "pose_rmse_dtheta": 0.2999184727668762,
      "pose_rmse_dx": 0.28336670994758606,
      "pose_rmse_dy": 0.20784015953540802,
      "pose_rmse_mean": 0.2637084722518921,
      "rmse_dtheta": 0.04107125103473663,
      "rmse_dx": 0.030073553323745728,
      "rmse_dy": 0.012294457294046879,
      "rmse_mean": 0.02781308814883232,
      "rotation_flip": 0.01044386439025402,
      "sparse_tokens": 7035.0,
      "step": 1010,
      "turn_loss": 0.31559494137763977,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 9406.0,
      "epoch": 0.04697082326705074,
      "grad_norm": 0.4268200099468231,
      "learning_rate": 9.86215809791488e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.03187616541981697,
      "mae_dx": 0.011373958550393581,
      "mae_dy": 0.007225435227155685,
      "pose_mae_dtheta": 0.2644106447696686,
      "pose_mae_dx": 0.08469383418560028,
      "pose_mae_dy": 0.09913117438554764,
      "pose_rmse_dtheta": 0.39587175846099854,
      "pose_rmse_dx": 0.1804008185863495,
      "pose_rmse_dy": 0.20500017702579498,
      "pose_rmse_mean": 0.26042425632476807,
      "rmse_dtheta": 0.04670163244009018,
      "rmse_dx": 0.024047860875725746,
      "rmse_dy": 0.01185391005128622,
      "rmse_mean": 0.027534468099474907,
      "rotation_flip": 0.017543859779834747,
      "sparse_tokens": 7501.0,
      "step": 1011,
      "turn_loss": 0.3110796809196472,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.047017283032893514,
      "grad_norm": 0.7344422340393066,
      "learning_rate": 9.861849601988384e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.027331342920660973,
      "mae_dx": 0.006766574922949076,
      "mae_dy": 0.004772144369781017,
      "pose_mae_dtheta": 0.16863830387592316,
      "pose_mae_dx": 0.056196749210357666,
      "pose_mae_dy": 0.07676640897989273,
      "pose_rmse_dtheta": 0.2509978413581848,
      "pose_rmse_dx": 0.1379621922969818,
      "pose_rmse_dy": 0.13638734817504883,
      "pose_rmse_mean": 0.17511579394340515,
      "rmse_dtheta": 0.04295003041625023,
      "rmse_dx": 0.01862337626516819,
      "rmse_dy": 0.007906476967036724,
      "rmse_mean": 0.02315996214747429,
      "rotation_flip": 0.032581452280282974,
      "sparse_tokens": 7204.0,
      "step": 1012,
      "turn_loss": 0.23760473728179932,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.04706374279873629,
      "grad_norm": 0.60716712474823,
      "learning_rate": 9.861540766070136e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.012566927820444107,
      "mae_dx": 0.004061238840222359,
      "mae_dy": 0.002815733663737774,
      "pose_mae_dtheta": 0.09318781644105911,
      "pose_mae_dx": 0.04370142146945,
      "pose_mae_dy": 0.03403546288609505,
      "pose_rmse_dtheta": 0.19246429204940796,
      "pose_rmse_dx": 0.14493201673030853,
      "pose_rmse_dy": 0.07357192784547806,
      "pose_rmse_mean": 0.13698941469192505,
      "rmse_dtheta": 0.023292476311326027,
      "rmse_dx": 0.01225998904556036,
      "rmse_dy": 0.006854176055639982,
      "rmse_mean": 0.01413554698228836,
      "rotation_flip": 0.004780876450240612,
      "sparse_tokens": 32073.0,
      "step": 1013,
      "turn_loss": 0.12466762214899063,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.047110202564579075,
      "grad_norm": 0.9169416427612305,
      "learning_rate": 9.861231590181732e-06,
      "loss": 0.2999,
      "mae_dtheta": 0.03788411244750023,
      "mae_dx": 0.011123568750917912,
      "mae_dy": 0.004164176061749458,
      "pose_mae_dtheta": 0.30568644404411316,
      "pose_mae_dx": 0.0879463329911232,
      "pose_mae_dy": 0.055429939180612564,
      "pose_rmse_dtheta": 0.5436834692955017,
      "pose_rmse_dx": 0.20448385179042816,
      "pose_rmse_dy": 0.13235080242156982,
      "pose_rmse_mean": 0.29350605607032776,
      "rmse_dtheta": 0.057852476835250854,
      "rmse_dx": 0.02286078780889511,
      "rmse_dy": 0.007863444276154041,
      "rmse_mean": 0.029525570571422577,
      "rotation_flip": 0.008534850552678108,
      "sparse_tokens": 12170.0,
      "step": 1014,
      "turn_loss": 0.2961251735687256,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.04715666233042185,
      "grad_norm": 0.6570402979850769,
      "learning_rate": 9.860922074344794e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.01193179003894329,
      "mae_dx": 0.0023708578664809465,
      "mae_dy": 0.0026219948194921017,
      "pose_mae_dtheta": 0.08496102690696716,
      "pose_mae_dx": 0.03156953677535057,
      "pose_mae_dy": 0.03515149652957916,
      "pose_rmse_dtheta": 0.19162139296531677,
      "pose_rmse_dx": 0.07669544965028763,
      "pose_rmse_dy": 0.07487906515598297,
      "pose_rmse_mean": 0.11439864337444305,
      "rmse_dtheta": 0.023380689322948456,
      "rmse_dx": 0.007312511093914509,
      "rmse_dy": 0.005387637298554182,
      "rmse_mean": 0.012026946060359478,
      "rotation_flip": 0.0037297969684004784,
      "sparse_tokens": 32057.0,
      "step": 1015,
      "turn_loss": 0.09479449689388275,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.047203122096264635,
      "grad_norm": 0.5661745667457581,
      "learning_rate": 9.860612218580966e-06,
      "loss": 0.1542,
      "mae_dtheta": 0.011557848192751408,
      "mae_dx": 0.001876278081908822,
      "mae_dy": 0.0022050703410059214,
      "pose_mae_dtheta": 0.08091778308153152,
      "pose_mae_dx": 0.023380231112241745,
      "pose_mae_dy": 0.03208668529987335,
      "pose_rmse_dtheta": 0.20270384848117828,
      "pose_rmse_dx": 0.07074987143278122,
      "pose_rmse_dy": 0.08088908344507217,
      "pose_rmse_mean": 0.11811426281929016,
      "rmse_dtheta": 0.02438046596944332,
      "rmse_dx": 0.006645523943006992,
      "rmse_dy": 0.005745193921029568,
      "rmse_mean": 0.012257061898708344,
      "rotation_flip": 0.0020040080416947603,
      "sparse_tokens": 32057.0,
      "step": 1016,
      "turn_loss": 0.08941735327243805,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.04724958186210741,
      "grad_norm": 0.3735928237438202,
      "learning_rate": 9.860302022911918e-06,
      "loss": 0.0787,
      "mae_dtheta": 0.007989626377820969,
      "mae_dx": 0.0016521041980013251,
      "mae_dy": 0.0009594009025022388,
      "pose_mae_dtheta": 0.05605956166982651,
      "pose_mae_dx": 0.01609606295824051,
      "pose_mae_dy": 0.015083028003573418,
      "pose_rmse_dtheta": 0.18128515779972076,
      "pose_rmse_dx": 0.04303063079714775,
      "pose_rmse_dy": 0.04669220745563507,
      "pose_rmse_mean": 0.09033600986003876,
      "rmse_dtheta": 0.024033373221755028,
      "rmse_dx": 0.005210558418184519,
      "rmse_dy": 0.00249627698212862,
      "rmse_mean": 0.01058006938546896,
      "rotation_flip": 0.002730748150497675,
      "sparse_tokens": 32137.0,
      "step": 1017,
      "turn_loss": 0.046038344502449036,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.047296041627950196,
      "grad_norm": 0.498372882604599,
      "learning_rate": 9.85999148735934e-06,
      "loss": 0.1351,
      "mae_dtheta": 0.013471790589392185,
      "mae_dx": 0.0029911836609244347,
      "mae_dy": 0.003888854058459401,
      "pose_mae_dtheta": 0.1005285382270813,
      "pose_mae_dx": 0.03959949314594269,
      "pose_mae_dy": 0.040460340678691864,
      "pose_rmse_dtheta": 0.2291499376296997,
      "pose_rmse_dx": 0.10281208157539368,
      "pose_rmse_dy": 0.10099858045578003,
      "pose_rmse_mean": 0.14432020485401154,
      "rmse_dtheta": 0.027380412444472313,
      "rmse_dx": 0.00852805282920599,
      "rmse_dy": 0.008675781078636646,
      "rmse_mean": 0.014861415140330791,
      "rotation_flip": 0.007020280696451664,
      "sparse_tokens": 32105.0,
      "step": 1018,
      "turn_loss": 0.11405517160892487,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.04734250139379297,
      "grad_norm": 0.7499897480010986,
      "learning_rate": 9.859680611944948e-06,
      "loss": 0.1714,
      "mae_dtheta": 0.03811146691441536,
      "mae_dx": 0.010096834041178226,
      "mae_dy": 0.003072404768317938,
      "pose_mae_dtheta": 0.31955161690711975,
      "pose_mae_dx": 0.08038929849863052,
      "pose_mae_dy": 0.028915036469697952,
      "pose_rmse_dtheta": 0.5387815237045288,
      "pose_rmse_dx": 0.1812431961297989,
      "pose_rmse_dy": 0.07969029992818832,
      "pose_rmse_mean": 0.26657167077064514,
      "rmse_dtheta": 0.0559072270989418,
      "rmse_dx": 0.0206769909709692,
      "rmse_dy": 0.007461067754775286,
      "rmse_mean": 0.028015097603201866,
      "rotation_flip": 0.00812347698956728,
      "sparse_tokens": 20675.0,
      "step": 1019,
      "turn_loss": 0.2908242344856262,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.047388961159635756,
      "grad_norm": 0.6952716112136841,
      "learning_rate": 9.859369396690484e-06,
      "loss": 0.1386,
      "mae_dtheta": 0.011276192963123322,
      "mae_dx": 0.003329765284433961,
      "mae_dy": 0.0022084489464759827,
      "pose_mae_dtheta": 0.07773958146572113,
      "pose_mae_dx": 0.033275850117206573,
      "pose_mae_dy": 0.028507838025689125,
      "pose_rmse_dtheta": 0.2090156078338623,
      "pose_rmse_dx": 0.08493411540985107,
      "pose_rmse_dy": 0.07085416465997696,
      "pose_rmse_mean": 0.12160129845142365,
      "rmse_dtheta": 0.025442518293857574,
      "rmse_dx": 0.009694925509393215,
      "rmse_dy": 0.00457794452086091,
      "rmse_mean": 0.013238463550806046,
      "rotation_flip": 0.002410606713965535,
      "sparse_tokens": 32169.0,
      "step": 1020,
      "turn_loss": 0.11206965893507004,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.04743542092547853,
      "grad_norm": 0.6327696442604065,
      "learning_rate": 9.859057841617709e-06,
      "loss": 0.1759,
      "mae_dtheta": 0.009271828457713127,
      "mae_dx": 0.0017127998871728778,
      "mae_dy": 0.0017146028112620115,
      "pose_mae_dtheta": 0.07027096301317215,
      "pose_mae_dx": 0.021353965625166893,
      "pose_mae_dy": 0.0290695670992136,
      "pose_rmse_dtheta": 0.17314621806144714,
      "pose_rmse_dx": 0.057885706424713135,
      "pose_rmse_dy": 0.07005847245454788,
      "pose_rmse_mean": 0.10036346316337585,
      "rmse_dtheta": 0.021516211330890656,
      "rmse_dx": 0.005548649467527866,
      "rmse_dy": 0.003613631473854184,
      "rmse_mean": 0.010226164013147354,
      "rotation_flip": 0.00685938261449337,
      "sparse_tokens": 32073.0,
      "step": 1021,
      "turn_loss": 0.06997493654489517,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04748188069132132,
      "grad_norm": 0.7124425768852234,
      "learning_rate": 9.858745946748411e-06,
      "loss": 0.2235,
      "mae_dtheta": 0.015528389252722263,
      "mae_dx": 0.004102814942598343,
      "mae_dy": 0.0038092383183538914,
      "pose_mae_dtheta": 0.11652065813541412,
      "pose_mae_dx": 0.04993196949362755,
      "pose_mae_dy": 0.05724146589636803,
      "pose_rmse_dtheta": 0.2491663545370102,
      "pose_rmse_dx": 0.12812605500221252,
      "pose_rmse_dy": 0.14103902876377106,
      "pose_rmse_mean": 0.17277714610099792,
      "rmse_dtheta": 0.02924630045890808,
      "rmse_dx": 0.012539996765553951,
      "rmse_dy": 0.00833176076412201,
      "rmse_mean": 0.016706019639968872,
      "rotation_flip": 0.009238728322088718,
      "sparse_tokens": 32089.0,
      "step": 1022,
      "turn_loss": 0.18127143383026123,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.047528340457164094,
      "grad_norm": 0.6312183141708374,
      "learning_rate": 9.858433712104403e-06,
      "loss": 0.1159,
      "mae_dtheta": 0.008871679194271564,
      "mae_dx": 0.002357323421165347,
      "mae_dy": 0.002351936185732484,
      "pose_mae_dtheta": 0.06290265172719955,
      "pose_mae_dx": 0.02718849666416645,
      "pose_mae_dy": 0.033260464668273926,
      "pose_rmse_dtheta": 0.12577351927757263,
      "pose_rmse_dx": 0.07704498618841171,
      "pose_rmse_dy": 0.08043821156024933,
      "pose_rmse_mean": 0.09441890567541122,
      "rmse_dtheta": 0.01710209622979164,
      "rmse_dx": 0.007845000363886356,
      "rmse_dy": 0.005251582246273756,
      "rmse_mean": 0.010066226124763489,
      "rotation_flip": 0.0035938904620707035,
      "sparse_tokens": 32089.0,
      "step": 1023,
      "turn_loss": 0.07219000905752182,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.04757480022300688,
      "grad_norm": 0.4626254141330719,
      "learning_rate": 9.858121137707515e-06,
      "loss": 0.1264,
      "mae_dtheta": 0.023935619741678238,
      "mae_dx": 0.008891092613339424,
      "mae_dy": 0.005716434679925442,
      "pose_mae_dtheta": 0.19272981584072113,
      "pose_mae_dx": 0.07413718849420547,
      "pose_mae_dy": 0.0684749111533165,
      "pose_rmse_dtheta": 0.36779123544692993,
      "pose_rmse_dx": 0.1619819849729538,
      "pose_rmse_dy": 0.16374412178993225,
      "pose_rmse_mean": 0.23117244243621826,
      "rmse_dtheta": 0.040261756628751755,
      "rmse_dx": 0.019722415134310722,
      "rmse_dy": 0.012083528563380241,
      "rmse_mean": 0.02402256801724434,
      "rotation_flip": 0.012707722373306751,
      "sparse_tokens": 21370.0,
      "step": 1024,
      "turn_loss": 0.23043230175971985,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.047621259988849654,
      "grad_norm": 0.4491153359413147,
      "learning_rate": 9.85780822357961e-06,
      "loss": 0.1113,
      "mae_dtheta": 0.013081376440823078,
      "mae_dx": 0.003058250527828932,
      "mae_dy": 0.0018535180715844035,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4491150677204132,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 144.68850708007812,
      "model/head/act_norm_mean": 108.42505129419192,
      "model/head/act_norm_min": 64.74365997314453,
      "model/head/act_over_embed": 74.51071034069193,
      "model/head/grad_frac": 0.10758809000253677,
      "model/head/grad_norm": 0.04831943288445473,
      "model/head/grad_zero_frac": 0.00014753137656953186,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6791203046085859,
      "model/head/update_ratio": 0.0008427167194895446,
      "model/head/weight_delta": 3.5646026134490967,
      "model/head/weight_delta_rel": 0.06253369152545929,
      "model/head/weight_norm": 57.33769226074219,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4116821587085724,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4116110267480874,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4115247130393982,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28286295114443194,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10015849024057388,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04498268663883209,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5382358661825726,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014658067375421524,
      "model/modality_embedder.encoders.pose/weight_delta": 1.096514344215393,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.03582654148340225,
      "model/modality_embedder.encoders.pose/weight_norm": 30.688005447387695,
      "model/modality_embedder/grad_frac": 0.10015849024057388,
      "model/modality_embedder/grad_norm": 0.04498268663883209,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5382358661825726,
      "model/modality_embedder/update_ratio": 0.0014658067375421524,
      "model/modality_embedder/weight_delta": 1.096514344215393,
      "model/modality_embedder/weight_delta_rel": 0.03582654148340225,
      "model/modality_embedder/weight_norm": 30.688005447387695,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.08997344970703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.19739808802309,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.936820030212402,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.941469143552053,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08480022102594376,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03808505833148956,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013838353333994746,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.5759251117706299,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.02098705805838108,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.521379470825195,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.57170867919922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.307827781786116,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.222261428833008,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.70456682511259,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08347974717617035,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03749201074242592,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001292080502025783,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.6991342306137085,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.02421855553984642,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.01677703857422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.1376953125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.25348975869809,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.42292308807373,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.04164395122092,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09432151168584824,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04236121103167534,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001414805301465094,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.7317152619361877,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.02456962876021862,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.94137191772461,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 80.9025650024414,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.08922057880391,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.398733139038086,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.30317535718035,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10679895430803299,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.047965019941329956,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001632722676731646,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.6189587116241455,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.021153071895241737,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.377321243286133,
      "model/normalizer/grad_frac": 0.4067658483982086,
      "model/normalizer/grad_norm": 0.18268467485904694,
      "model/normalizer/grad_zero_frac": 0.0001311729574808851,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0023478209041059017,
      "model/normalizer/weight_delta": 1.3526571989059448,
      "model/normalizer/weight_delta_rel": 0.01742144115269184,
      "model/normalizer/weight_norm": 77.81031036376953,
      "pose_mae_dtheta": 0.09503240883350372,
      "pose_mae_dx": 0.028535163030028343,
      "pose_mae_dy": 0.023288898169994354,
      "pose_rmse_dtheta": 0.2538264989852905,
      "pose_rmse_dx": 0.07309871166944504,
      "pose_rmse_dy": 0.05900505930185318,
      "pose_rmse_mean": 0.12864342331886292,
      "rmse_dtheta": 0.029940592125058174,
      "rmse_dx": 0.008471830748021603,
      "rmse_dy": 0.004124572034925222,
      "rmse_mean": 0.014178997837007046,
      "rotation_flip": 0.006380715873092413,
      "sparse_tokens": 32249.0,
      "step": 1025,
      "turn_loss": 0.0955507755279541,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.04766771975469244,
      "grad_norm": 0.8796783685684204,
      "learning_rate": 9.857494969742568e-06,
      "loss": 0.2335,
      "mae_dtheta": 0.038739342242479324,
      "mae_dx": 0.01875504106283188,
      "mae_dy": 0.006316756829619408,
      "pose_mae_dtheta": 0.29788148403167725,
      "pose_mae_dx": 0.15260908007621765,
      "pose_mae_dy": 0.06770185381174088,
      "pose_rmse_dtheta": 0.5181583762168884,
      "pose_rmse_dx": 0.30017468333244324,
      "pose_rmse_dy": 0.15334047377109528,
      "pose_rmse_mean": 0.32389116287231445,
      "rmse_dtheta": 0.05659763142466545,
      "rmse_dx": 0.03179115056991577,
      "rmse_dy": 0.014589326456189156,
      "rmse_mean": 0.034326039254665375,
      "rotation_flip": 0.018855219706892967,
      "sparse_tokens": 26400.0,
      "step": 1026,
      "turn_loss": 0.3582365810871124,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 7816.0,
      "epoch": 0.047714179520535215,
      "grad_norm": 0.663047194480896,
      "learning_rate": 9.857181376218295e-06,
      "loss": 0.1365,
      "mae_dtheta": 0.05084722116589546,
      "mae_dx": 0.010682647116482258,
      "mae_dy": 0.00466250441968441,
      "pose_mae_dtheta": 0.39969316124916077,
      "pose_mae_dx": 0.07189372181892395,
      "pose_mae_dy": 0.05565553531050682,
      "pose_rmse_dtheta": 0.6447802782058716,
      "pose_rmse_dx": 0.1881372481584549,
      "pose_rmse_dy": 0.12305508553981781,
      "pose_rmse_mean": 0.3186575472354889,
      "rmse_dtheta": 0.07071352750062943,
      "rmse_dx": 0.022522423416376114,
      "rmse_dy": 0.009440986439585686,
      "rmse_mean": 0.03422565013170242,
      "rotation_flip": 0.03333333507180214,
      "sparse_tokens": 6613.0,
      "step": 1027,
      "turn_loss": 0.25232383608818054,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.047760639286378,
      "grad_norm": 0.592732310295105,
      "learning_rate": 9.856867443028723e-06,
      "loss": 0.1506,
      "mae_dtheta": 0.012170580215752125,
      "mae_dx": 0.0019860335160046816,
      "mae_dy": 0.0022565273102372885,
      "pose_mae_dtheta": 0.08544433861970901,
      "pose_mae_dx": 0.02340635098516941,
      "pose_mae_dy": 0.0299467071890831,
      "pose_rmse_dtheta": 0.20579753816127777,
      "pose_rmse_dx": 0.059399090707302094,
      "pose_rmse_dy": 0.06711771339178085,
      "pose_rmse_mean": 0.11077144742012024,
      "rmse_dtheta": 0.02543690986931324,
      "rmse_dx": 0.006240582559257746,
      "rmse_dy": 0.005125981289893389,
      "rmse_mean": 0.0122678242623806,
      "rotation_flip": 0.0072278911247849464,
      "sparse_tokens": 32073.0,
      "step": 1028,
      "turn_loss": 0.0890987291932106,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.047807099052220775,
      "grad_norm": 0.48294293880462646,
      "learning_rate": 9.856553170195803e-06,
      "loss": 0.1704,
      "mae_dtheta": 0.03114832006394863,
      "mae_dx": 0.013976622372865677,
      "mae_dy": 0.005347089376300573,
      "pose_mae_dtheta": 0.2547343969345093,
      "pose_mae_dx": 0.12116505950689316,
      "pose_mae_dy": 0.08752279728651047,
      "pose_rmse_dtheta": 0.44452500343322754,
      "pose_rmse_dx": 0.27257972955703735,
      "pose_rmse_dy": 0.1781330704689026,
      "pose_rmse_mean": 0.29841262102127075,
      "rmse_dtheta": 0.04873413220047951,
      "rmse_dx": 0.028030525892972946,
      "rmse_dy": 0.009652581997215748,
      "rmse_mean": 0.028805747628211975,
      "rotation_flip": 0.012670565396547318,
      "sparse_tokens": 20190.0,
      "step": 1029,
      "turn_loss": 0.23515430092811584,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.04785355881806356,
      "grad_norm": 0.44070374965667725,
      "learning_rate": 9.856238557741514e-06,
      "loss": 0.1332,
      "mae_dtheta": 0.014183119870722294,
      "mae_dx": 0.0028247751761227846,
      "mae_dy": 0.0037069853860884905,
      "pose_mae_dtheta": 0.10130555182695389,
      "pose_mae_dx": 0.03634972497820854,
      "pose_mae_dy": 0.03653593733906746,
      "pose_rmse_dtheta": 0.2569202780723572,
      "pose_rmse_dx": 0.08338752388954163,
      "pose_rmse_dy": 0.07645412534475327,
      "pose_rmse_mean": 0.1389206498861313,
      "rmse_dtheta": 0.029414935037493706,
      "rmse_dx": 0.0070817493833601475,
      "rmse_dy": 0.007954658009111881,
      "rmse_mean": 0.014817113988101482,
      "rotation_flip": 0.0050687906332314014,
      "sparse_tokens": 32121.0,
      "step": 1030,
      "turn_loss": 0.11298517137765884,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.047900018583906336,
      "grad_norm": 0.5344605445861816,
      "learning_rate": 9.855923605687854e-06,
      "loss": 0.1391,
      "mae_dtheta": 0.010693267919123173,
      "mae_dx": 0.0026479673106223345,
      "mae_dy": 0.0027100814040750265,
      "pose_mae_dtheta": 0.07458453625440598,
      "pose_mae_dx": 0.029714906588196754,
      "pose_mae_dy": 0.03067808598279953,
      "pose_rmse_dtheta": 0.19642648100852966,
      "pose_rmse_dx": 0.08951389044523239,
      "pose_rmse_dy": 0.0870308205485344,
      "pose_rmse_mean": 0.12432374060153961,
      "rmse_dtheta": 0.025465235114097595,
      "rmse_dx": 0.008593639358878136,
      "rmse_dy": 0.008399232290685177,
      "rmse_mean": 0.014152703806757927,
      "rotation_flip": 0.006458557676523924,
      "sparse_tokens": 32057.0,
      "step": 1031,
      "turn_loss": 0.08606048673391342,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.04794647834974912,
      "grad_norm": 0.5098020434379578,
      "learning_rate": 9.85560831405685e-06,
      "loss": 0.142,
      "mae_dtheta": 0.013864685781300068,
      "mae_dx": 0.0029721118044108152,
      "mae_dy": 0.0029112929478287697,
      "pose_mae_dtheta": 0.10515493899583817,
      "pose_mae_dx": 0.03246382996439934,
      "pose_mae_dy": 0.032555799931287766,
      "pose_rmse_dtheta": 0.26321548223495483,
      "pose_rmse_dx": 0.08341015130281448,
      "pose_rmse_dy": 0.07830848544836044,
      "pose_rmse_mean": 0.14164471626281738,
      "rmse_dtheta": 0.030316032469272614,
      "rmse_dx": 0.007985292933881283,
      "rmse_dy": 0.008219304494559765,
      "rmse_mean": 0.015506877563893795,
      "rotation_flip": 0.006947459653019905,
      "sparse_tokens": 32105.0,
      "step": 1032,
      "turn_loss": 0.11953382939100266,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.047992938115591896,
      "grad_norm": 0.9234268069267273,
      "learning_rate": 9.855292682870552e-06,
      "loss": 0.1628,
      "mae_dtheta": 0.04988245293498039,
      "mae_dx": 0.016075119376182556,
      "mae_dy": 0.0071084946393966675,
      "pose_mae_dtheta": 0.4133008122444153,
      "pose_mae_dx": 0.1366143524646759,
      "pose_mae_dy": 0.07497881352901459,
      "pose_rmse_dtheta": 0.6417813301086426,
      "pose_rmse_dx": 0.2796086370944977,
      "pose_rmse_dy": 0.17392399907112122,
      "pose_rmse_mean": 0.36510464549064636,
      "rmse_dtheta": 0.06690005213022232,
      "rmse_dx": 0.02908315695822239,
      "rmse_dy": 0.01455981656908989,
      "rmse_mean": 0.03684767708182335,
      "rotation_flip": 0.014766201376914978,
      "sparse_tokens": 20276.0,
      "step": 1033,
      "turn_loss": 0.4222554564476013,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04803939788143468,
      "grad_norm": 0.474853515625,
      "learning_rate": 9.85497671215103e-06,
      "loss": 0.1122,
      "mae_dtheta": 0.014325389638543129,
      "mae_dx": 0.004196499474346638,
      "mae_dy": 0.004458682145923376,
      "pose_mae_dtheta": 0.11226147413253784,
      "pose_mae_dx": 0.05083680897951126,
      "pose_mae_dy": 0.04732239246368408,
      "pose_rmse_dtheta": 0.2567887306213379,
      "pose_rmse_dx": 0.1403530240058899,
      "pose_rmse_dy": 0.14213313162326813,
      "pose_rmse_mean": 0.17975829541683197,
      "rmse_dtheta": 0.029220396652817726,
      "rmse_dx": 0.012019254267215729,
      "rmse_dy": 0.011634417809545994,
      "rmse_mean": 0.017624689266085625,
      "rotation_flip": 0.008724553510546684,
      "sparse_tokens": 32089.0,
      "step": 1034,
      "turn_loss": 0.15982283651828766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04808585764727746,
      "grad_norm": 0.6182622313499451,
      "learning_rate": 9.854660401920382e-06,
      "loss": 0.1609,
      "mae_dtheta": 0.014415019191801548,
      "mae_dx": 0.003627123311161995,
      "mae_dy": 0.0033230572007596493,
      "pose_mae_dtheta": 0.10277289152145386,
      "pose_mae_dx": 0.04430422559380531,
      "pose_mae_dy": 0.05058795586228371,
      "pose_rmse_dtheta": 0.19693464040756226,
      "pose_rmse_dx": 0.09245096892118454,
      "pose_rmse_dy": 0.10726143419742584,
      "pose_rmse_mean": 0.132215678691864,
      "rmse_dtheta": 0.025862520560622215,
      "rmse_dx": 0.009043572470545769,
      "rmse_dy": 0.006212734617292881,
      "rmse_mean": 0.013706276193261147,
      "rotation_flip": 0.008595040999352932,
      "sparse_tokens": 32089.0,
      "step": 1035,
      "turn_loss": 0.1589125692844391,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04813231741312024,
      "grad_norm": 0.5132720470428467,
      "learning_rate": 9.854343752200725e-06,
      "loss": 0.2367,
      "mae_dtheta": 0.013142026029527187,
      "mae_dx": 0.0037687215954065323,
      "mae_dy": 0.003538022516295314,
      "pose_mae_dtheta": 0.091310515999794,
      "pose_mae_dx": 0.04436030983924866,
      "pose_mae_dy": 0.04066988453269005,
      "pose_rmse_dtheta": 0.22315968573093414,
      "pose_rmse_dx": 0.11408131569623947,
      "pose_rmse_dy": 0.10508446395397186,
      "pose_rmse_mean": 0.1474418342113495,
      "rmse_dtheta": 0.027761971578001976,
      "rmse_dx": 0.00992155447602272,
      "rmse_dy": 0.008294024504721165,
      "rmse_mean": 0.015325849875807762,
      "rotation_flip": 0.010353753343224525,
      "sparse_tokens": 32089.0,
      "step": 1036,
      "turn_loss": 0.14585158228874207,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.04817877717896302,
      "grad_norm": 0.5029410123825073,
      "learning_rate": 9.854026763014205e-06,
      "loss": 0.1794,
      "mae_dtheta": 0.010349038057029247,
      "mae_dx": 0.002412864239886403,
      "mae_dy": 0.0019602510146796703,
      "pose_mae_dtheta": 0.0748278796672821,
      "pose_mae_dx": 0.025469912216067314,
      "pose_mae_dy": 0.025271397083997726,
      "pose_rmse_dtheta": 0.17895111441612244,
      "pose_rmse_dx": 0.06135665997862816,
      "pose_rmse_dy": 0.057385995984077454,
      "pose_rmse_mean": 0.09923126548528671,
      "rmse_dtheta": 0.02233962155878544,
      "rmse_dx": 0.007349429652094841,
      "rmse_dy": 0.003947236575186253,
      "rmse_mean": 0.011212095618247986,
      "rotation_flip": 0.003426124108955264,
      "sparse_tokens": 32137.0,
      "step": 1037,
      "turn_loss": 0.0906822606921196,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.0482252369448058,
      "grad_norm": 0.9529740810394287,
      "learning_rate": 9.853709434382988e-06,
      "loss": 0.2006,
      "mae_dtheta": 0.04580098018050194,
      "mae_dx": 0.013781080022454262,
      "mae_dy": 0.017749663442373276,
      "pose_mae_dtheta": 0.4044662117958069,
      "pose_mae_dx": 0.16992419958114624,
      "pose_mae_dy": 0.18438720703125,
      "pose_rmse_dtheta": 0.6192140579223633,
      "pose_rmse_dx": 0.30358147621154785,
      "pose_rmse_dy": 0.32097703218460083,
      "pose_rmse_mean": 0.41459083557128906,
      "rmse_dtheta": 0.062173787504434586,
      "rmse_dx": 0.025699596852064133,
      "rmse_dy": 0.030851369723677635,
      "rmse_mean": 0.03957492113113403,
      "rotation_flip": 0.012422360479831696,
      "sparse_tokens": 6994.0,
      "step": 1038,
      "turn_loss": 0.5034061670303345,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.04827169671064858,
      "grad_norm": 0.46402084827423096,
      "learning_rate": 9.853391766329264e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.0175032839179039,
      "mae_dx": 0.002687357598915696,
      "mae_dy": 0.0037742028944194317,
      "pose_mae_dtheta": 0.1316559612751007,
      "pose_mae_dx": 0.034976255148649216,
      "pose_mae_dy": 0.04809475317597389,
      "pose_rmse_dtheta": 0.2942741811275482,
      "pose_rmse_dx": 0.08875118941068649,
      "pose_rmse_dy": 0.12172695249319077,
      "pose_rmse_mean": 0.16825078427791595,
      "rmse_dtheta": 0.0333063043653965,
      "rmse_dx": 0.007711798418313265,
      "rmse_dy": 0.008870952762663364,
      "rmse_mean": 0.01662968471646309,
      "rotation_flip": 0.010721944272518158,
      "sparse_tokens": 32089.0,
      "step": 1039,
      "turn_loss": 0.13544203341007233,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.04831815647649136,
      "grad_norm": 0.552394449710846,
      "learning_rate": 9.853073758875249e-06,
      "loss": 0.128,
      "mae_dtheta": 0.014606388285756111,
      "mae_dx": 0.0025581475347280502,
      "mae_dy": 0.0031560075003653765,
      "pose_mae_dtheta": 0.101265549659729,
      "pose_mae_dx": 0.03464456647634506,
      "pose_mae_dy": 0.036055050790309906,
      "pose_rmse_dtheta": 0.24187374114990234,
      "pose_rmse_dx": 0.08634589612483978,
      "pose_rmse_dy": 0.08739464730024338,
      "pose_rmse_mean": 0.13853810727596283,
      "rmse_dtheta": 0.029553785920143127,
      "rmse_dx": 0.006215643137693405,
      "rmse_dy": 0.006903196219354868,
      "rmse_mean": 0.014224208891391754,
      "rotation_flip": 0.0037983425427228212,
      "sparse_tokens": 32169.0,
      "step": 1040,
      "turn_loss": 0.11258280277252197,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9085.0,
      "epoch": 0.04836461624233414,
      "grad_norm": 0.5939102172851562,
      "learning_rate": 9.85275541204318e-06,
      "loss": 0.1628,
      "mae_dtheta": 0.040630072355270386,
      "mae_dx": 0.01488513220101595,
      "mae_dy": 0.004980994388461113,
      "pose_mae_dtheta": 0.33937734365463257,
      "pose_mae_dx": 0.10223862528800964,
      "pose_mae_dy": 0.07638908922672272,
      "pose_rmse_dtheta": 0.6119617223739624,
      "pose_rmse_dx": 0.2259681224822998,
      "pose_rmse_dy": 0.1601792275905609,
      "pose_rmse_mean": 0.3327030539512634,
      "rmse_dtheta": 0.06117524951696396,
      "rmse_dx": 0.02815808355808258,
      "rmse_dy": 0.00865007285028696,
      "rmse_mean": 0.032661136239767075,
      "rotation_flip": 0.020202020183205605,
      "sparse_tokens": 7323.0,
      "step": 1041,
      "turn_loss": 0.23193767666816711,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.04841107600817692,
      "grad_norm": 0.35369205474853516,
      "learning_rate": 9.852436725855324e-06,
      "loss": 0.0754,
      "mae_dtheta": 0.013045495375990868,
      "mae_dx": 0.002711054403334856,
      "mae_dy": 0.0028131965082138777,
      "pose_mae_dtheta": 0.09166127443313599,
      "pose_mae_dx": 0.03062157891690731,
      "pose_mae_dy": 0.03357173502445221,
      "pose_rmse_dtheta": 0.20834706723690033,
      "pose_rmse_dx": 0.08560127764940262,
      "pose_rmse_dy": 0.06969346106052399,
      "pose_rmse_mean": 0.12121393531560898,
      "rmse_dtheta": 0.02585713192820549,
      "rmse_dx": 0.009875757619738579,
      "rmse_dy": 0.006607062183320522,
      "rmse_mean": 0.014113317243754864,
      "rotation_flip": 0.006569343153387308,
      "sparse_tokens": 32105.0,
      "step": 1042,
      "turn_loss": 0.10951736569404602,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.0484575357740197,
      "grad_norm": 0.6091546416282654,
      "learning_rate": 9.852117700333961e-06,
      "loss": 0.2044,
      "mae_dtheta": 0.028911758214235306,
      "mae_dx": 0.012242431752383709,
      "mae_dy": 0.004436650313436985,
      "pose_mae_dtheta": 0.2372289001941681,
      "pose_mae_dx": 0.09279516339302063,
      "pose_mae_dy": 0.06259126216173172,
      "pose_rmse_dtheta": 0.4289165735244751,
      "pose_rmse_dx": 0.2073674201965332,
      "pose_rmse_dy": 0.15008246898651123,
      "pose_rmse_mean": 0.26212215423583984,
      "rmse_dtheta": 0.04528486356139183,
      "rmse_dx": 0.024220561608672142,
      "rmse_dy": 0.009204897098243237,
      "rmse_mean": 0.026236772537231445,
      "rotation_flip": 0.011937557719647884,
      "sparse_tokens": 19101.0,
      "step": 1043,
      "turn_loss": 0.23377272486686707,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.04850399553986248,
      "grad_norm": 0.6584001183509827,
      "learning_rate": 9.851798335501403e-06,
      "loss": 0.1827,
      "mae_dtheta": 0.012216232717037201,
      "mae_dx": 0.0024976558052003384,
      "mae_dy": 0.004050294868648052,
      "pose_mae_dtheta": 0.08643252402544022,
      "pose_mae_dx": 0.041110485792160034,
      "pose_mae_dy": 0.04558423534035683,
      "pose_rmse_dtheta": 0.18581272661685944,
      "pose_rmse_dx": 0.1120593398809433,
      "pose_rmse_dy": 0.10364765673875809,
      "pose_rmse_mean": 0.1338399052619934,
      "rmse_dtheta": 0.023884020745754242,
      "rmse_dx": 0.006754235364496708,
      "rmse_dy": 0.008747123181819916,
      "rmse_mean": 0.013128459453582764,
      "rotation_flip": 0.004885993432253599,
      "sparse_tokens": 32057.0,
      "step": 1044,
      "turn_loss": 0.12349484115839005,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.04855045530570526,
      "grad_norm": 0.6366980671882629,
      "learning_rate": 9.851478631379982e-06,
      "loss": 0.1813,
      "mae_dtheta": 0.010417571291327477,
      "mae_dx": 0.0027153692208230495,
      "mae_dy": 0.003110476303845644,
      "pose_mae_dtheta": 0.077146515250206,
      "pose_mae_dx": 0.031190838664770126,
      "pose_mae_dy": 0.025500264018774033,
      "pose_rmse_dtheta": 0.19574280083179474,
      "pose_rmse_dx": 0.07299777865409851,
      "pose_rmse_dy": 0.06445509940385818,
      "pose_rmse_mean": 0.11106523126363754,
      "rmse_dtheta": 0.02290915884077549,
      "rmse_dx": 0.006604508496820927,
      "rmse_dy": 0.007103574462234974,
      "rmse_mean": 0.01220574788749218,
      "rotation_flip": 0.002116402145475149,
      "sparse_tokens": 32185.0,
      "step": 1045,
      "turn_loss": 0.09573492407798767,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.04859691507154804,
      "grad_norm": 0.5639957189559937,
      "learning_rate": 9.851158587992059e-06,
      "loss": 0.0906,
      "mae_dtheta": 0.03276808187365532,
      "mae_dx": 0.014882638119161129,
      "mae_dy": 0.0043667759746313095,
      "pose_mae_dtheta": 0.24843472242355347,
      "pose_mae_dx": 0.12835422158241272,
      "pose_mae_dy": 0.0452619269490242,
      "pose_rmse_dtheta": 0.45195475220680237,
      "pose_rmse_dx": 0.24005340039730072,
      "pose_rmse_dy": 0.11896282434463501,
      "pose_rmse_mean": 0.27032366394996643,
      "rmse_dtheta": 0.04983416199684143,
      "rmse_dx": 0.026952698826789856,
      "rmse_dy": 0.010362119413912296,
      "rmse_mean": 0.02904966101050377,
      "rotation_flip": 0.018315019086003304,
      "sparse_tokens": 9571.0,
      "step": 1046,
      "turn_loss": 0.2259785383939743,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.04864337483739082,
      "grad_norm": 0.5885834693908691,
      "learning_rate": 9.850838205360012e-06,
      "loss": 0.146,
      "mae_dtheta": 0.034042004495859146,
      "mae_dx": 0.011420872993767262,
      "mae_dy": 0.0025111008435487747,
      "pose_mae_dtheta": 0.2756025791168213,
      "pose_mae_dx": 0.07973257452249527,
      "pose_mae_dy": 0.04051848128437996,
      "pose_rmse_dtheta": 0.5328988432884216,
      "pose_rmse_dx": 0.1614316999912262,
      "pose_rmse_dy": 0.08482683449983597,
      "pose_rmse_mean": 0.2597191333770752,
      "rmse_dtheta": 0.05646197497844696,
      "rmse_dx": 0.021527843549847603,
      "rmse_dy": 0.004638779908418655,
      "rmse_mean": 0.02754286490380764,
      "rotation_flip": 0.004464285913854837,
      "sparse_tokens": 3898.0,
      "step": 1047,
      "turn_loss": 0.1840626299381256,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.048689834603233596,
      "grad_norm": 0.8115649223327637,
      "learning_rate": 9.850517483506244e-06,
      "loss": 0.1473,
      "mae_dtheta": 0.012338830158114433,
      "mae_dx": 0.004206431098282337,
      "mae_dy": 0.0021405364386737347,
      "pose_mae_dtheta": 0.09967945516109467,
      "pose_mae_dx": 0.04583035409450531,
      "pose_mae_dy": 0.03584827855229378,
      "pose_rmse_dtheta": 0.21529221534729004,
      "pose_rmse_dx": 0.11793066561222076,
      "pose_rmse_dy": 0.08827084302902222,
      "pose_rmse_mean": 0.14049790799617767,
      "rmse_dtheta": 0.02449478767812252,
      "rmse_dx": 0.011920526623725891,
      "rmse_dy": 0.004447004292160273,
      "rmse_mean": 0.013620774261653423,
      "rotation_flip": 0.0025138261262327433,
      "sparse_tokens": 32057.0,
      "step": 1048,
      "turn_loss": 0.11500907689332962,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1663.0,
      "epoch": 0.04873629436907638,
      "grad_norm": 0.543602466583252,
      "learning_rate": 9.850196422453185e-06,
      "loss": 0.1757,
      "mae_dtheta": 0.04769570380449295,
      "mae_dx": 0.02297903038561344,
      "mae_dy": 0.01679180935025215,
      "pose_mae_dtheta": 0.43322253227233887,
      "pose_mae_dx": 0.2137359231710434,
      "pose_mae_dy": 0.28488627076148987,
      "pose_rmse_dtheta": 0.5756450891494751,
      "pose_rmse_dx": 0.33589082956314087,
      "pose_rmse_dy": 0.495341420173645,
      "pose_rmse_mean": 0.46895909309387207,
      "rmse_dtheta": 0.06594749540090561,
      "rmse_dx": 0.03355806693434715,
      "rmse_dy": 0.02479296550154686,
      "rmse_mean": 0.04143284261226654,
      "rotation_flip": 0.0,
      "sparse_tokens": 1450.0,
      "step": 1049,
      "turn_loss": 0.6583474278450012,
      "turns": 5.0,
      "turns_per_sample": 5.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.04878275413491916,
      "grad_norm": 0.7476425170898438,
      "learning_rate": 9.849875022223287e-06,
      "loss": 0.1449,
      "mae_dtheta": 0.014331426471471786,
      "mae_dx": 0.003116198815405369,
      "mae_dy": 0.004834786057472229,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7476425170898438,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 144.4104766845703,
      "model/head/act_norm_mean": 117.77312155330883,
      "model/head/act_norm_min": 100.32456970214844,
      "model/head/act_over_embed": 80.9347917407697,
      "model/head/grad_frac": 0.09322760254144669,
      "model/head/grad_norm": 0.06970091909170151,
      "model/head/grad_zero_frac": 9.613334259483963e-05,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6779641544117647,
      "model/head/update_ratio": 0.0012154701398685575,
      "model/head/weight_delta": 3.600015878677368,
      "model/head/weight_delta_rel": 0.06315494328737259,
      "model/head/weight_norm": 57.34482192993164,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4116949737071991,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4116487503051758,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4116066098213196,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2828888751260366,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07888034731149673,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05897429957985878,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5356987847222222,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019215740030631423,
      "model/modality_embedder.encoders.pose/weight_delta": 1.1099393367767334,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.03626517578959465,
      "model/modality_embedder.encoders.pose/weight_norm": 30.69062042236328,
      "model/modality_embedder/grad_frac": 0.07888034731149673,
      "model/modality_embedder/grad_norm": 0.05897429957985878,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5356987847222222,
      "model/modality_embedder/update_ratio": 0.0019215740030631423,
      "model/modality_embedder/weight_delta": 1.1099393367767334,
      "model/modality_embedder/weight_delta_rel": 0.03626517578959465,
      "model/modality_embedder/weight_norm": 30.69062042236328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.4046401977539,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.007301879084967,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.014540672302246,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.498042611208533,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06603654474020004,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04937172681093216,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017937847878783941,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.5863460898399353,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.021366804838180542,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.523773193359375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.06161499023438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.958214796335202,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.630975723266602,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.151518870529888,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06609741598367691,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04941723868250847,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017028080765157938,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.7134060859680176,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.02471294440329075,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.021026611328125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.81314086914062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.814073806605975,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.375917434692383,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.426882557213762,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07317332923412323,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.054707493633031845,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 8.574080129619688e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018269025022163987,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.7474179863929749,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.025096897035837173,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.945491790771484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.52633666992188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.79396263713819,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.91427230834961,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.78748069756677,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07794519513845444,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.058275144547224045,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 9.0784378699027e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001983605558052659,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.6310475468635559,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.021566210314631462,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.378395080566406,
      "model/normalizer/grad_frac": 0.2658325135707855,
      "model/normalizer/grad_norm": 0.1987476795911789,
      "model/normalizer/grad_zero_frac": 0.00011344689119141549,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0025541246868669987,
      "model/normalizer/weight_delta": 1.3797693252563477,
      "model/normalizer/weight_delta_rel": 0.01777062937617302,
      "model/normalizer/weight_norm": 77.81439971923828,
      "pose_mae_dtheta": 0.10801026970148087,
      "pose_mae_dx": 0.040576111525297165,
      "pose_mae_dy": 0.0672214925289154,
      "pose_rmse_dtheta": 0.2172749638557434,
      "pose_rmse_dx": 0.11078282445669174,
      "pose_rmse_dy": 0.1659468561410904,
      "pose_rmse_mean": 0.1646682322025299,
      "rmse_dtheta": 0.02575431764125824,
      "rmse_dx": 0.01042510662227869,
      "rmse_dy": 0.010081644169986248,
      "rmse_mean": 0.015420356765389442,
      "rotation_flip": 0.005494505632668734,
      "sparse_tokens": 4573.0,
      "step": 1050,
      "turn_loss": 0.13208729028701782,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.04882921390076194,
      "grad_norm": 0.7387471199035645,
      "learning_rate": 9.849553282839025e-06,
      "loss": 0.1499,
      "mae_dtheta": 0.00958910584449768,
      "mae_dx": 0.002459615468978882,
      "mae_dy": 0.003184808883816004,
      "pose_mae_dtheta": 0.07036003470420837,
      "pose_mae_dx": 0.03598842769861221,
      "pose_mae_dy": 0.0345473550260067,
      "pose_rmse_dtheta": 0.19088810682296753,
      "pose_rmse_dx": 0.10893001407384872,
      "pose_rmse_dy": 0.09767680615186691,
      "pose_rmse_mean": 0.13249832391738892,
      "rmse_dtheta": 0.022705957293510437,
      "rmse_dx": 0.006939692888408899,
      "rmse_dy": 0.008923545479774475,
      "rmse_mean": 0.01285639964044094,
      "rotation_flip": 0.005111524369567633,
      "sparse_tokens": 32057.0,
      "step": 1051,
      "turn_loss": 0.08828812092542648,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.04887567366660472,
      "grad_norm": 0.6723912358283997,
      "learning_rate": 9.849231204322902e-06,
      "loss": 0.152,
      "mae_dtheta": 0.031852640211582184,
      "mae_dx": 0.013358332216739655,
      "mae_dy": 0.006333677563816309,
      "pose_mae_dtheta": 0.23573459684848785,
      "pose_mae_dx": 0.13858512043952942,
      "pose_mae_dy": 0.09963151067495346,
      "pose_rmse_dtheta": 0.3763274550437927,
      "pose_rmse_dx": 0.3006884753704071,
      "pose_rmse_dy": 0.18453148007392883,
      "pose_rmse_mean": 0.28718245029449463,
      "rmse_dtheta": 0.04494725912809372,
      "rmse_dx": 0.028041716665029526,
      "rmse_dy": 0.010528515093028545,
      "rmse_mean": 0.027839161455631256,
      "rotation_flip": 0.010204081423580647,
      "sparse_tokens": 10226.0,
      "step": 1052,
      "turn_loss": 0.26411980390548706,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.0489221334324475,
      "grad_norm": 0.6375839114189148,
      "learning_rate": 9.848908786697437e-06,
      "loss": 0.1442,
      "mae_dtheta": 0.03448541834950447,
      "mae_dx": 0.013721980154514313,
      "mae_dy": 0.006879723630845547,
      "pose_mae_dtheta": 0.2531774640083313,
      "pose_mae_dx": 0.1062152162194252,
      "pose_mae_dy": 0.08675247430801392,
      "pose_rmse_dtheta": 0.4456619322299957,
      "pose_rmse_dx": 0.22963781654834747,
      "pose_rmse_dy": 0.17957663536071777,
      "pose_rmse_mean": 0.2849588096141815,
      "rmse_dtheta": 0.0524851456284523,
      "rmse_dx": 0.0271686390042305,
      "rmse_dy": 0.011774511076509953,
      "rmse_mean": 0.030476098880171776,
      "rotation_flip": 0.020481927320361137,
      "sparse_tokens": 15623.0,
      "step": 1053,
      "turn_loss": 0.28549250960350037,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.04896859319829028,
      "grad_norm": 0.7909714579582214,
      "learning_rate": 9.848586029985177e-06,
      "loss": 0.1257,
      "mae_dtheta": 0.0408758670091629,
      "mae_dx": 0.006259760819375515,
      "mae_dy": 0.01043016742914915,
      "pose_mae_dtheta": 0.3495548367500305,
      "pose_mae_dx": 0.046338483691215515,
      "pose_mae_dy": 0.08525294065475464,
      "pose_rmse_dtheta": 0.5718805193901062,
      "pose_rmse_dx": 0.11441453546285629,
      "pose_rmse_dy": 0.1922895759344101,
      "pose_rmse_mean": 0.29286155104637146,
      "rmse_dtheta": 0.060000184923410416,
      "rmse_dx": 0.013528183102607727,
      "rmse_dy": 0.024751711636781693,
      "rmse_mean": 0.032760024070739746,
      "rotation_flip": 0.01904761977493763,
      "sparse_tokens": 3554.0,
      "step": 1054,
      "turn_loss": 0.40141135454177856,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.04901505296413306,
      "grad_norm": 0.41658708453178406,
      "learning_rate": 9.848262934208693e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.008433791808784008,
      "mae_dx": 0.0016921072965487838,
      "mae_dy": 0.0004222567949909717,
      "pose_mae_dtheta": 0.06544266641139984,
      "pose_mae_dx": 0.0160826463252306,
      "pose_mae_dy": 0.006660924758762121,
      "pose_rmse_dtheta": 0.2621646523475647,
      "pose_rmse_dx": 0.03861340880393982,
      "pose_rmse_dy": 0.022851750254631042,
      "pose_rmse_mean": 0.10787659883499146,
      "rmse_dtheta": 0.02963009849190712,
      "rmse_dx": 0.004624835681170225,
      "rmse_dy": 0.00112536468077451,
      "rmse_mean": 0.01179343368858099,
      "rotation_flip": 0.0006724949344061315,
      "sparse_tokens": 32169.0,
      "step": 1055,
      "turn_loss": 0.04520978406071663,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.04906151272997584,
      "grad_norm": 0.8557193875312805,
      "learning_rate": 9.847939499390581e-06,
      "loss": 0.3256,
      "mae_dtheta": 0.04082128778100014,
      "mae_dx": 0.012792535126209259,
      "mae_dy": 0.004014238249510527,
      "pose_mae_dtheta": 0.3310982286930084,
      "pose_mae_dx": 0.10042288154363632,
      "pose_mae_dy": 0.05307091027498245,
      "pose_rmse_dtheta": 0.5803849697113037,
      "pose_rmse_dx": 0.19468270242214203,
      "pose_rmse_dy": 0.11686777323484421,
      "pose_rmse_mean": 0.29731184244155884,
      "rmse_dtheta": 0.060492485761642456,
      "rmse_dx": 0.02293924055993557,
      "rmse_dy": 0.007524412125349045,
      "rmse_mean": 0.030318712815642357,
      "rotation_flip": 0.020449897274374962,
      "sparse_tokens": 8632.0,
      "step": 1056,
      "turn_loss": 0.36258551478385925,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.04910797249581862,
      "grad_norm": 0.7243705987930298,
      "learning_rate": 9.847615725553457e-06,
      "loss": 0.2129,
      "mae_dtheta": 0.043397367000579834,
      "mae_dx": 0.012190724723041058,
      "mae_dy": 0.008849851787090302,
      "pose_mae_dtheta": 0.3602159023284912,
      "pose_mae_dx": 0.10496478527784348,
      "pose_mae_dy": 0.11636385321617126,
      "pose_rmse_dtheta": 0.6127661466598511,
      "pose_rmse_dx": 0.2299349159002304,
      "pose_rmse_dy": 0.2296966314315796,
      "pose_rmse_mean": 0.357465922832489,
      "rmse_dtheta": 0.06300473213195801,
      "rmse_dx": 0.02430119179189205,
      "rmse_dy": 0.016080226749181747,
      "rmse_mean": 0.03446204960346222,
      "rotation_flip": 0.020504731684923172,
      "sparse_tokens": 20687.0,
      "step": 1057,
      "turn_loss": 0.30911877751350403,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 27495.0,
      "epoch": 0.0491544322616614,
      "grad_norm": 0.7327179908752441,
      "learning_rate": 9.847291612719965e-06,
      "loss": 0.1843,
      "mae_dtheta": 0.037145502865314484,
      "mae_dx": 0.011553650721907616,
      "mae_dy": 0.005879903212189674,
      "pose_mae_dtheta": 0.31077709794044495,
      "pose_mae_dx": 0.09974780678749084,
      "pose_mae_dy": 0.06982141733169556,
      "pose_rmse_dtheta": 0.5173923969268799,
      "pose_rmse_dx": 0.22245807945728302,
      "pose_rmse_dy": 0.16458171606063843,
      "pose_rmse_mean": 0.3014774024486542,
      "rmse_dtheta": 0.05544884130358696,
      "rmse_dx": 0.024427836760878563,
      "rmse_dy": 0.011785567738115788,
      "rmse_mean": 0.03055408224463463,
      "rotation_flip": 0.007614213041961193,
      "sparse_tokens": 21232.0,
      "step": 1058,
      "turn_loss": 0.2973495125770569,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.04920089202750418,
      "grad_norm": 0.4817618727684021,
      "learning_rate": 9.846967160912765e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.00879365112632513,
      "mae_dx": 0.0015036821132525802,
      "mae_dy": 0.0012250468134880066,
      "pose_mae_dtheta": 0.06674293428659439,
      "pose_mae_dx": 0.01620352827012539,
      "pose_mae_dy": 0.019731011241674423,
      "pose_rmse_dtheta": 0.21399569511413574,
      "pose_rmse_dx": 0.038516588509082794,
      "pose_rmse_dy": 0.0528029203414917,
      "pose_rmse_mean": 0.10177173465490341,
      "rmse_dtheta": 0.024112120270729065,
      "rmse_dx": 0.0045848023146390915,
      "rmse_dy": 0.0027054008096456528,
      "rmse_mean": 0.010467441752552986,
      "rotation_flip": 0.0031088083051145077,
      "sparse_tokens": 32121.0,
      "step": 1059,
      "turn_loss": 0.06387562304735184,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.04924735179334696,
      "grad_norm": 0.586187481880188,
      "learning_rate": 9.846642370154555e-06,
      "loss": 0.1668,
      "mae_dtheta": 0.03363833576440811,
      "mae_dx": 0.017263775691390038,
      "mae_dy": 0.0052027469500899315,
      "pose_mae_dtheta": 0.21801722049713135,
      "pose_mae_dx": 0.14645713567733765,
      "pose_mae_dy": 0.07188285887241364,
      "pose_rmse_dtheta": 0.34681323170661926,
      "pose_rmse_dx": 0.29495152831077576,
      "pose_rmse_dy": 0.12906037271022797,
      "pose_rmse_mean": 0.2569417357444763,
      "rmse_dtheta": 0.04869228973984718,
      "rmse_dx": 0.030575120821595192,
      "rmse_dy": 0.008155440911650658,
      "rmse_mean": 0.029140952974557877,
      "rotation_flip": 0.003759398590773344,
      "sparse_tokens": 4526.0,
      "step": 1060,
      "turn_loss": 0.26845359802246094,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.04929381155918974,
      "grad_norm": 0.5340254306793213,
      "learning_rate": 9.84631724046804e-06,
      "loss": 0.1301,
      "mae_dtheta": 0.03197060897946358,
      "mae_dx": 0.0054206931963562965,
      "mae_dy": 0.003086836775764823,
      "pose_mae_dtheta": 0.27093788981437683,
      "pose_mae_dx": 0.040747176855802536,
      "pose_mae_dy": 0.029331807047128677,
      "pose_rmse_dtheta": 0.5774812698364258,
      "pose_rmse_dx": 0.11704409867525101,
      "pose_rmse_dy": 0.07830855995416641,
      "pose_rmse_mean": 0.25761133432388306,
      "rmse_dtheta": 0.054424747824668884,
      "rmse_dx": 0.01319751888513565,
      "rmse_dy": 0.006898518186062574,
      "rmse_mean": 0.024840261787176132,
      "rotation_flip": 0.005319148767739534,
      "sparse_tokens": 6684.0,
      "step": 1061,
      "turn_loss": 0.21382808685302734,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.04934027132503252,
      "grad_norm": 0.6574100255966187,
      "learning_rate": 9.845991771875958e-06,
      "loss": 0.1786,
      "mae_dtheta": 0.04223230481147766,
      "mae_dx": 0.008646951988339424,
      "mae_dy": 0.0057177129201591015,
      "pose_mae_dtheta": 0.3403286933898926,
      "pose_mae_dx": 0.09170421212911606,
      "pose_mae_dy": 0.06326200067996979,
      "pose_rmse_dtheta": 0.5662837624549866,
      "pose_rmse_dx": 0.17662964761257172,
      "pose_rmse_dy": 0.13426417112350464,
      "pose_rmse_mean": 0.2923925518989563,
      "rmse_dtheta": 0.05975589528679848,
      "rmse_dx": 0.017326565459370613,
      "rmse_dy": 0.011585265398025513,
      "rmse_mean": 0.02955590933561325,
      "rotation_flip": 0.02167630009353161,
      "sparse_tokens": 11030.0,
      "step": 1062,
      "turn_loss": 0.2971656024456024,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.049386731090875303,
      "grad_norm": 0.6123417019844055,
      "learning_rate": 9.845665964401072e-06,
      "loss": 0.1444,
      "mae_dtheta": 0.011386260390281677,
      "mae_dx": 0.0022713439539074898,
      "mae_dy": 0.002344353822991252,
      "pose_mae_dtheta": 0.09534639865159988,
      "pose_mae_dx": 0.02031136117875576,
      "pose_mae_dy": 0.02376285195350647,
      "pose_rmse_dtheta": 0.28617575764656067,
      "pose_rmse_dx": 0.06540308892726898,
      "pose_rmse_dy": 0.06771079450845718,
      "pose_rmse_mean": 0.13976320624351501,
      "rmse_dtheta": 0.02931382693350315,
      "rmse_dx": 0.007263035047799349,
      "rmse_dy": 0.00838509388267994,
      "rmse_mean": 0.014987319707870483,
      "rotation_flip": 0.00823305919766426,
      "sparse_tokens": 32057.0,
      "step": 1063,
      "turn_loss": 0.08809062093496323,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.04943319085671808,
      "grad_norm": 0.651500940322876,
      "learning_rate": 9.845339818066164e-06,
      "loss": 0.0991,
      "mae_dtheta": 0.014423937536776066,
      "mae_dx": 0.00991043820977211,
      "mae_dy": 0.0025468680541962385,
      "pose_mae_dtheta": 0.11867611110210419,
      "pose_mae_dx": 0.06914077699184418,
      "pose_mae_dy": 0.0439516045153141,
      "pose_rmse_dtheta": 0.28729313611984253,
      "pose_rmse_dx": 0.18331506848335266,
      "pose_rmse_dy": 0.10946059972047806,
      "pose_rmse_mean": 0.19335627555847168,
      "rmse_dtheta": 0.03015422634780407,
      "rmse_dx": 0.022862212732434273,
      "rmse_dy": 0.005218889564275742,
      "rmse_mean": 0.019411776214838028,
      "rotation_flip": 0.01529636699706316,
      "sparse_tokens": 17707.0,
      "step": 1064,
      "turn_loss": 0.1369408220052719,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.049479650622560864,
      "grad_norm": 0.43141430616378784,
      "learning_rate": 9.845013332894042e-06,
      "loss": 0.1299,
      "mae_dtheta": 0.011654220521450043,
      "mae_dx": 0.0019715081434696913,
      "mae_dy": 0.0029907457064837217,
      "pose_mae_dtheta": 0.0792987123131752,
      "pose_mae_dx": 0.02961449883878231,
      "pose_mae_dy": 0.0451139360666275,
      "pose_rmse_dtheta": 0.16985082626342773,
      "pose_rmse_dx": 0.07638730853796005,
      "pose_rmse_dy": 0.12583154439926147,
      "pose_rmse_mean": 0.12402322888374329,
      "rmse_dtheta": 0.021441586315631866,
      "rmse_dx": 0.006177661474794149,
      "rmse_dy": 0.007284197956323624,
      "rmse_mean": 0.011634482070803642,
      "rotation_flip": 0.0037835792172700167,
      "sparse_tokens": 32089.0,
      "step": 1065,
      "turn_loss": 0.09999999403953552,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33088.0,
      "epoch": 0.04952611038840364,
      "grad_norm": 0.7073598504066467,
      "learning_rate": 9.844686508907538e-06,
      "loss": 0.2109,
      "mae_dtheta": 0.02420334704220295,
      "mae_dx": 0.008503376506268978,
      "mae_dy": 0.0038558095693588257,
      "pose_mae_dtheta": 0.17050141096115112,
      "pose_mae_dx": 0.07362915575504303,
      "pose_mae_dy": 0.05417177826166153,
      "pose_rmse_dtheta": 0.29476019740104675,
      "pose_rmse_dx": 0.15430425107479095,
      "pose_rmse_dy": 0.12286020815372467,
      "pose_rmse_mean": 0.19064155220985413,
      "rmse_dtheta": 0.03956107422709465,
      "rmse_dx": 0.018608080223202705,
      "rmse_dy": 0.007508882787078619,
      "rmse_mean": 0.02189267985522747,
      "rotation_flip": 0.013130615465342999,
      "sparse_tokens": 27680.0,
      "step": 1066,
      "turn_loss": 0.20295533537864685,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.049572570154246424,
      "grad_norm": 0.8649941086769104,
      "learning_rate": 9.844359346129504e-06,
      "loss": 0.1688,
      "mae_dtheta": 0.049928296357393265,
      "mae_dx": 0.015577827580273151,
      "mae_dy": 0.003656320972368121,
      "pose_mae_dtheta": 0.4225108325481415,
      "pose_mae_dx": 0.13851357996463776,
      "pose_mae_dy": 0.04827585816383362,
      "pose_rmse_dtheta": 0.658061683177948,
      "pose_rmse_dx": 0.28175634145736694,
      "pose_rmse_dy": 0.10058128833770752,
      "pose_rmse_mean": 0.3467997908592224,
      "rmse_dtheta": 0.06822024285793304,
      "rmse_dx": 0.029268046841025352,
      "rmse_dy": 0.0068094381131231785,
      "rmse_mean": 0.03476591035723686,
      "rotation_flip": 0.013333333656191826,
      "sparse_tokens": 11316.0,
      "step": 1067,
      "turn_loss": 0.28819510340690613,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.0496190299200892,
      "grad_norm": 0.6170566082000732,
      "learning_rate": 9.844031844582822e-06,
      "loss": 0.1661,
      "mae_dtheta": 0.04605261608958244,
      "mae_dx": 0.013674194924533367,
      "mae_dy": 0.003989120479673147,
      "pose_mae_dtheta": 0.3300491273403168,
      "pose_mae_dx": 0.11347674578428268,
      "pose_mae_dy": 0.04800407215952873,
      "pose_rmse_dtheta": 0.5781056880950928,
      "pose_rmse_dx": 0.20359376072883606,
      "pose_rmse_dy": 0.14133505523204803,
      "pose_rmse_mean": 0.3076781630516052,
      "rmse_dtheta": 0.06726089864969254,
      "rmse_dx": 0.023991204798221588,
      "rmse_dy": 0.008612793870270252,
      "rmse_mean": 0.03328830003738403,
      "rotation_flip": 0.006329114083200693,
      "sparse_tokens": 5356.0,
      "step": 1068,
      "turn_loss": 0.3353739380836487,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.049665489685931985,
      "grad_norm": 0.4979217052459717,
      "learning_rate": 9.843704004290393e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.03353112190961838,
      "mae_dx": 0.016303805634379387,
      "mae_dy": 0.0026479510124772787,
      "pose_mae_dtheta": 0.2589333951473236,
      "pose_mae_dx": 0.11545446515083313,
      "pose_mae_dy": 0.03483256325125694,
      "pose_rmse_dtheta": 0.4515976905822754,
      "pose_rmse_dx": 0.23900914192199707,
      "pose_rmse_dy": 0.09286585450172424,
      "pose_rmse_mean": 0.2611575722694397,
      "rmse_dtheta": 0.05279494449496269,
      "rmse_dx": 0.028978344053030014,
      "rmse_dy": 0.0067417193204164505,
      "rmse_mean": 0.02950500324368477,
      "rotation_flip": 0.00615384615957737,
      "sparse_tokens": 6390.0,
      "step": 1069,
      "turn_loss": 0.27444005012512207,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 34607.0,
      "epoch": 0.04971194945177476,
      "grad_norm": 0.7229781150817871,
      "learning_rate": 9.843375825275144e-06,
      "loss": 0.2485,
      "mae_dtheta": 0.04190820828080177,
      "mae_dx": 0.015453687869012356,
      "mae_dy": 0.010206560604274273,
      "pose_mae_dtheta": 0.3604830503463745,
      "pose_mae_dx": 0.1332373470067978,
      "pose_mae_dy": 0.11363742500543594,
      "pose_rmse_dtheta": 0.5668410062789917,
      "pose_rmse_dx": 0.23898090422153473,
      "pose_rmse_dy": 0.2523404359817505,
      "pose_rmse_mean": 0.35272079706192017,
      "rmse_dtheta": 0.059184085577726364,
      "rmse_dx": 0.026835745200514793,
      "rmse_dy": 0.020529702305793762,
      "rmse_mean": 0.035516511648893356,
      "rotation_flip": 0.017323775216937065,
      "sparse_tokens": 28446.0,
      "step": 1070,
      "turn_loss": 0.37336266040802,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.049758409217617545,
      "grad_norm": 0.4412921667098999,
      "learning_rate": 9.843047307560024e-06,
      "loss": 0.146,
      "mae_dtheta": 0.03472067043185234,
      "mae_dx": 0.010928678326308727,
      "mae_dy": 0.005396177526563406,
      "pose_mae_dtheta": 0.2762356102466583,
      "pose_mae_dx": 0.07864192128181458,
      "pose_mae_dy": 0.06828682869672775,
      "pose_rmse_dtheta": 0.5061912536621094,
      "pose_rmse_dx": 0.1755559891462326,
      "pose_rmse_dy": 0.16931793093681335,
      "pose_rmse_mean": 0.28368839621543884,
      "rmse_dtheta": 0.053557682782411575,
      "rmse_dx": 0.02275853417813778,
      "rmse_dy": 0.010553168132901192,
      "rmse_mean": 0.02895646169781685,
      "rotation_flip": 0.01666666753590107,
      "sparse_tokens": 8219.0,
      "step": 1071,
      "turn_loss": 0.27321967482566833,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.04980486898346032,
      "grad_norm": 0.7627681493759155,
      "learning_rate": 9.842718451168006e-06,
      "loss": 0.1784,
      "mae_dtheta": 0.011803899891674519,
      "mae_dx": 0.002769279992207885,
      "mae_dy": 0.0029758212622255087,
      "pose_mae_dtheta": 0.08052823692560196,
      "pose_mae_dx": 0.03396400064229965,
      "pose_mae_dy": 0.040277253836393356,
      "pose_rmse_dtheta": 0.14439420402050018,
      "pose_rmse_dx": 0.07998541742563248,
      "pose_rmse_dy": 0.08658067882061005,
      "pose_rmse_mean": 0.1036534309387207,
      "rmse_dtheta": 0.02025383710861206,
      "rmse_dx": 0.007970267906785011,
      "rmse_dy": 0.005229249130934477,
      "rmse_mean": 0.011151118203997612,
      "rotation_flip": 0.005490734241902828,
      "sparse_tokens": 32121.0,
      "step": 1072,
      "turn_loss": 0.11697345227003098,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.049851328749303106,
      "grad_norm": 0.6749396920204163,
      "learning_rate": 9.842389256122086e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.009561487473547459,
      "mae_dx": 0.001851739943958819,
      "mae_dy": 0.0030461300630122423,
      "pose_mae_dtheta": 0.06803452223539352,
      "pose_mae_dx": 0.028048168867826462,
      "pose_mae_dy": 0.038614049553871155,
      "pose_rmse_dtheta": 0.15948207676410675,
      "pose_rmse_dx": 0.07494144141674042,
      "pose_rmse_dy": 0.12140366435050964,
      "pose_rmse_mean": 0.11860906332731247,
      "rmse_dtheta": 0.020988192409276962,
      "rmse_dx": 0.005568675696849823,
      "rmse_dy": 0.009643742814660072,
      "rmse_mean": 0.012066870927810669,
      "rotation_flip": 0.0044843051582574844,
      "sparse_tokens": 32073.0,
      "step": 1073,
      "turn_loss": 0.0832991823554039,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11703.0,
      "epoch": 0.04989778851514588,
      "grad_norm": 0.5979370474815369,
      "learning_rate": 9.842059722445288e-06,
      "loss": 0.0979,
      "mae_dtheta": 0.02065643109381199,
      "mae_dx": 0.004378628451377153,
      "mae_dy": 0.004012914374470711,
      "pose_mae_dtheta": 0.12463975697755814,
      "pose_mae_dx": 0.03466813638806343,
      "pose_mae_dy": 0.06376209110021591,
      "pose_rmse_dtheta": 0.2229047566652298,
      "pose_rmse_dx": 0.08206465095281601,
      "pose_rmse_dy": 0.14207810163497925,
      "pose_rmse_mean": 0.14901584386825562,
      "rmse_dtheta": 0.03594731166958809,
      "rmse_dx": 0.01339740864932537,
      "rmse_dy": 0.007961563766002655,
      "rmse_mean": 0.01910209469497204,
      "rotation_flip": 0.00413223123177886,
      "sparse_tokens": 10046.0,
      "step": 1074,
      "turn_loss": 0.194946750998497,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 21749.0,
      "epoch": 0.049944248280988666,
      "grad_norm": 0.4412621855735779,
      "learning_rate": 9.841729850160652e-06,
      "loss": 0.1147,
      "mae_dtheta": 0.02565869502723217,
      "mae_dx": 0.005326553247869015,
      "mae_dy": 0.003792409785091877,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4412621259689331,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 145.85227966308594,
      "model/head/act_norm_mean": 109.5332322761194,
      "model/head/act_norm_min": 74.51893615722656,
      "model/head/act_over_embed": 75.27226268642632,
      "model/head/grad_frac": 0.13249854743480682,
      "model/head/grad_norm": 0.0584665909409523,
      "model/head/grad_zero_frac": 0.0001418204774381593,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6797166511194029,
      "model/head/update_ratio": 0.001019396586343646,
      "model/head/weight_delta": 3.649836301803589,
      "model/head/weight_delta_rel": 0.06402894109487534,
      "model/head/weight_norm": 57.3541145324707,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4116825461387634,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41162339378805723,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41155561804771423,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2828714498900813,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08093807101249695,
      "model/modality_embedder.encoders.pose/grad_norm": 0.035714905709028244,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5179802389705882,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011636469280347228,
      "model/modality_embedder.encoders.pose/weight_delta": 1.146010398864746,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.03744373098015785,
      "model/modality_embedder.encoders.pose/weight_norm": 30.692218780517578,
      "model/modality_embedder/grad_frac": 0.08093807101249695,
      "model/modality_embedder/grad_norm": 0.035714905709028244,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5179802389705882,
      "model/modality_embedder/update_ratio": 0.0011636469280347228,
      "model/modality_embedder/weight_delta": 1.146010398864746,
      "model/modality_embedder/weight_delta_rel": 0.03744373098015785,
      "model/modality_embedder/weight_norm": 30.692218780517578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.14337158203125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.310465899668326,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.971907615661621,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.01917040227219,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10128841549158096,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04469474032521248,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016237294767051935,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.5985438227653503,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.02181129716336727,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.525976181030273,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.9518051147461,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.273433798270553,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.577329635620117,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.68093095763915,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10632911324501038,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04691901057958603,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016164948465302587,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.7297470569610596,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.025279007852077484,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.02515411376953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.57157897949219,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.076424055318643,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.274734497070312,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.91996274214333,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.1193089410662651,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.052646517753601074,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017578211845830083,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.7641106843948364,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.025657406076788902,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.949871063232422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.2676010131836,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.02702447583511,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.128576278686523,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.260433612931102,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.13239827752113342,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05842234566807747,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001988376956433058,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.6465308666229248,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.02209535613656044,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.381925582885742,
      "model/normalizer/grad_frac": 0.4750351011753082,
      "model/normalizer/grad_norm": 0.20961499214172363,
      "model/normalizer/grad_zero_frac": 0.00013235470396466553,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00269362423568964,
      "model/normalizer/weight_delta": 1.4107693433761597,
      "model/normalizer/weight_delta_rel": 0.018169892951846123,
      "model/normalizer/weight_norm": 77.8189468383789,
      "pose_mae_dtheta": 0.1840837597846985,
      "pose_mae_dx": 0.04504179209470749,
      "pose_mae_dy": 0.0440228208899498,
      "pose_rmse_dtheta": 0.38012179732322693,
      "pose_rmse_dx": 0.14363990724086761,
      "pose_rmse_dy": 0.09293348342180252,
      "pose_rmse_mean": 0.20556506514549255,
      "rmse_dtheta": 0.04395598918199539,
      "rmse_dx": 0.01614336110651493,
      "rmse_dy": 0.007975230924785137,
      "rmse_mean": 0.022691525518894196,
      "rotation_flip": 0.007092198356986046,
      "sparse_tokens": 16834.0,
      "step": 1075,
      "turn_loss": 0.18373705446720123,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.04999070804683144,
      "grad_norm": 0.5285028219223022,
      "learning_rate": 9.841399639291252e-06,
      "loss": 0.0857,
      "mae_dtheta": 0.042149659246206284,
      "mae_dx": 0.015980925410985947,
      "mae_dy": 0.0047094132751226425,
      "pose_mae_dtheta": 0.33727824687957764,
      "pose_mae_dx": 0.11670801788568497,
      "pose_mae_dy": 0.07650288194417953,
      "pose_rmse_dtheta": 0.5018177032470703,
      "pose_rmse_dx": 0.2591998279094696,
      "pose_rmse_dy": 0.16404315829277039,
      "pose_rmse_mean": 0.30835360288619995,
      "rmse_dtheta": 0.056618642061948776,
      "rmse_dx": 0.030127042904496193,
      "rmse_dy": 0.007643829099833965,
      "rmse_mean": 0.031463172286748886,
      "rotation_flip": 0.0032786885276436806,
      "sparse_tokens": 5450.0,
      "step": 1076,
      "turn_loss": 0.2383750081062317,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.05003716781267423,
      "grad_norm": 0.5477844476699829,
      "learning_rate": 9.841069089860175e-06,
      "loss": 0.0943,
      "mae_dtheta": 0.011506444774568081,
      "mae_dx": 0.0018928276840597391,
      "mae_dy": 0.0018024209421128035,
      "pose_mae_dtheta": 0.08490245044231415,
      "pose_mae_dx": 0.022124072536826134,
      "pose_mae_dy": 0.02357962541282177,
      "pose_rmse_dtheta": 0.2507743239402771,
      "pose_rmse_dx": 0.05412404239177704,
      "pose_rmse_dy": 0.06590725481510162,
      "pose_rmse_mean": 0.12360187619924545,
      "rmse_dtheta": 0.02845074236392975,
      "rmse_dx": 0.0054841600358486176,
      "rmse_dy": 0.004634989891201258,
      "rmse_mean": 0.01285663153976202,
      "rotation_flip": 0.0073929959908127785,
      "sparse_tokens": 32185.0,
      "step": 1077,
      "turn_loss": 0.07100837677717209,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.050083627578517004,
      "grad_norm": 0.4861997663974762,
      "learning_rate": 9.84073820189054e-06,
      "loss": 0.1091,
      "mae_dtheta": 0.039624303579330444,
      "mae_dx": 0.00927074532955885,
      "mae_dy": 0.007361598312854767,
      "pose_mae_dtheta": 0.3111807405948639,
      "pose_mae_dx": 0.07989352941513062,
      "pose_mae_dy": 0.06419654935598373,
      "pose_rmse_dtheta": 0.5582783818244934,
      "pose_rmse_dx": 0.18597781658172607,
      "pose_rmse_dy": 0.1614208072423935,
      "pose_rmse_mean": 0.30189234018325806,
      "rmse_dtheta": 0.060916826128959656,
      "rmse_dx": 0.018986642360687256,
      "rmse_dy": 0.01737535186111927,
      "rmse_mean": 0.03242627531290054,
      "rotation_flip": 0.017432646825909615,
      "sparse_tokens": 11202.0,
      "step": 1078,
      "turn_loss": 0.2346770465373993,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.05013008734435979,
      "grad_norm": 0.49897170066833496,
      "learning_rate": 9.840406975405483e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.009846734814345837,
      "mae_dx": 0.0020394534803926945,
      "mae_dy": 0.0013125474797561765,
      "pose_mae_dtheta": 0.07238943129777908,
      "pose_mae_dx": 0.02184172347187996,
      "pose_mae_dy": 0.018664013594388962,
      "pose_rmse_dtheta": 0.21785061061382294,
      "pose_rmse_dx": 0.05029735341668129,
      "pose_rmse_dy": 0.04129502922296524,
      "pose_rmse_mean": 0.10314767062664032,
      "rmse_dtheta": 0.02474907785654068,
      "rmse_dx": 0.0058201877400279045,
      "rmse_dy": 0.0025751711800694466,
      "rmse_mean": 0.011048145592212677,
      "rotation_flip": 0.002953119343146682,
      "sparse_tokens": 32201.0,
      "step": 1079,
      "turn_loss": 0.07852766662836075,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.050176547110202564,
      "grad_norm": 0.4795772135257721,
      "learning_rate": 9.840075410428169e-06,
      "loss": 0.1259,
      "mae_dtheta": 0.014724168926477432,
      "mae_dx": 0.003448536153882742,
      "mae_dy": 0.00476644653826952,
      "pose_mae_dtheta": 0.10892997682094574,
      "pose_mae_dx": 0.04234180226922035,
      "pose_mae_dy": 0.0533943809568882,
      "pose_rmse_dtheta": 0.2606651484966278,
      "pose_rmse_dx": 0.10216296464204788,
      "pose_rmse_dy": 0.1457115262746811,
      "pose_rmse_mean": 0.16951321065425873,
      "rmse_dtheta": 0.0301375612616539,
      "rmse_dx": 0.009011998772621155,
      "rmse_dy": 0.011044653132557869,
      "rmse_mean": 0.01673140376806259,
      "rotation_flip": 0.009426848031580448,
      "sparse_tokens": 32089.0,
      "step": 1080,
      "turn_loss": 0.14277781546115875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.05022300687604535,
      "grad_norm": 0.5657023787498474,
      "learning_rate": 9.839743506981783e-06,
      "loss": 0.1517,
      "mae_dtheta": 0.011661299504339695,
      "mae_dx": 0.00192898022942245,
      "mae_dy": 0.002519036876037717,
      "pose_mae_dtheta": 0.08152449876070023,
      "pose_mae_dx": 0.028185062110424042,
      "pose_mae_dy": 0.0374511256814003,
      "pose_rmse_dtheta": 0.1734999567270279,
      "pose_rmse_dx": 0.06843265146017075,
      "pose_rmse_dy": 0.09920467436313629,
      "pose_rmse_mean": 0.11371243000030518,
      "rmse_dtheta": 0.024208616465330124,
      "rmse_dx": 0.005451503209769726,
      "rmse_dy": 0.0051598865538835526,
      "rmse_mean": 0.011606669053435326,
      "rotation_flip": 0.003643724601715803,
      "sparse_tokens": 32105.0,
      "step": 1081,
      "turn_loss": 0.10660471022129059,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.050269466641888125,
      "grad_norm": 0.48321521282196045,
      "learning_rate": 9.839411265089536e-06,
      "loss": 0.1747,
      "mae_dtheta": 0.01603558659553528,
      "mae_dx": 0.0027521681040525436,
      "mae_dy": 0.0035174591466784477,
      "pose_mae_dtheta": 0.12161696702241898,
      "pose_mae_dx": 0.030325114727020264,
      "pose_mae_dy": 0.04128943756222725,
      "pose_rmse_dtheta": 0.2881820797920227,
      "pose_rmse_dx": 0.07077569514513016,
      "pose_rmse_dy": 0.10293514281511307,
      "pose_rmse_mean": 0.1539643108844757,
      "rmse_dtheta": 0.03165602311491966,
      "rmse_dx": 0.007885552942752838,
      "rmse_dy": 0.008056476712226868,
      "rmse_mean": 0.01586601883172989,
      "rotation_flip": 0.005614035297185183,
      "sparse_tokens": 32137.0,
      "step": 1082,
      "turn_loss": 0.1360226720571518,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8114.0,
      "epoch": 0.05031592640773091,
      "grad_norm": 0.4635763168334961,
      "learning_rate": 9.83907868477466e-06,
      "loss": 0.1015,
      "mae_dtheta": 0.03180705010890961,
      "mae_dx": 0.008805870078504086,
      "mae_dy": 0.006651087198406458,
      "pose_mae_dtheta": 0.23218917846679688,
      "pose_mae_dx": 0.07751341909170151,
      "pose_mae_dy": 0.07564504444599152,
      "pose_rmse_dtheta": 0.3985976576805115,
      "pose_rmse_dx": 0.1714952439069748,
      "pose_rmse_dy": 0.15884247422218323,
      "pose_rmse_mean": 0.24297845363616943,
      "rmse_dtheta": 0.045861367136240005,
      "rmse_dx": 0.019248981028795242,
      "rmse_dy": 0.012838494032621384,
      "rmse_mean": 0.025982946157455444,
      "rotation_flip": 0.02083333395421505,
      "sparse_tokens": 6626.0,
      "step": 1083,
      "turn_loss": 0.3392149806022644,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.050362386173573685,
      "grad_norm": 0.7480792999267578,
      "learning_rate": 9.838745766060417e-06,
      "loss": 0.1729,
      "mae_dtheta": 0.024463580921292305,
      "mae_dx": 0.010296070016920567,
      "mae_dy": 0.004758188501000404,
      "pose_mae_dtheta": 0.21927323937416077,
      "pose_mae_dx": 0.10700371861457825,
      "pose_mae_dy": 0.07156341522932053,
      "pose_rmse_dtheta": 0.3798615634441376,
      "pose_rmse_dx": 0.2245776206254959,
      "pose_rmse_dy": 0.14579437673091888,
      "pose_rmse_mean": 0.25007787346839905,
      "rmse_dtheta": 0.0402136854827404,
      "rmse_dx": 0.022319870069622993,
      "rmse_dy": 0.00836130604147911,
      "rmse_mean": 0.0236316230148077,
      "rotation_flip": 0.002967359032481909,
      "sparse_tokens": 5569.0,
      "step": 1084,
      "turn_loss": 0.2171066254377365,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.05040884593941646,
      "grad_norm": 0.6297231912612915,
      "learning_rate": 9.838412508970084e-06,
      "loss": 0.1542,
      "mae_dtheta": 0.012520457617938519,
      "mae_dx": 0.0021839607506990433,
      "mae_dy": 0.002346436958760023,
      "pose_mae_dtheta": 0.09222108870744705,
      "pose_mae_dx": 0.028268590569496155,
      "pose_mae_dy": 0.03126835823059082,
      "pose_rmse_dtheta": 0.23879094421863556,
      "pose_rmse_dx": 0.06749739497900009,
      "pose_rmse_dy": 0.0809166431427002,
      "pose_rmse_mean": 0.12906832993030548,
      "rmse_dtheta": 0.027965150773525238,
      "rmse_dx": 0.00624112319201231,
      "rmse_dy": 0.0051105753518640995,
      "rmse_mean": 0.013105617836117744,
      "rotation_flip": 0.004557538777589798,
      "sparse_tokens": 32137.0,
      "step": 1085,
      "turn_loss": 0.1004629135131836,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.050455305705259246,
      "grad_norm": 0.5676940083503723,
      "learning_rate": 9.838078913526968e-06,
      "loss": 0.1863,
      "mae_dtheta": 0.02640560269355774,
      "mae_dx": 0.009249657392501831,
      "mae_dy": 0.00471963407471776,
      "pose_mae_dtheta": 0.19894054532051086,
      "pose_mae_dx": 0.06396590173244476,
      "pose_mae_dy": 0.05098463594913483,
      "pose_rmse_dtheta": 0.3730204999446869,
      "pose_rmse_dx": 0.1614885926246643,
      "pose_rmse_dy": 0.1267082244157791,
      "pose_rmse_mean": 0.22040575742721558,
      "rmse_dtheta": 0.042500272393226624,
      "rmse_dx": 0.020749585703015327,
      "rmse_dy": 0.009167913347482681,
      "rmse_mean": 0.02413925528526306,
      "rotation_flip": 0.010895883664488792,
      "sparse_tokens": 14216.0,
      "step": 1086,
      "turn_loss": 0.18201087415218353,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.05050176547110202,
      "grad_norm": 0.7523695230484009,
      "learning_rate": 9.837744979754397e-06,
      "loss": 0.1663,
      "mae_dtheta": 0.039823152124881744,
      "mae_dx": 0.010629058815538883,
      "mae_dy": 0.005762205459177494,
      "pose_mae_dtheta": 0.3417001962661743,
      "pose_mae_dx": 0.08795986324548721,
      "pose_mae_dy": 0.05616496875882149,
      "pose_rmse_dtheta": 0.5848633050918579,
      "pose_rmse_dx": 0.17459940910339355,
      "pose_rmse_dy": 0.1379590481519699,
      "pose_rmse_mean": 0.299140602350235,
      "rmse_dtheta": 0.06073744595050812,
      "rmse_dx": 0.020024970173835754,
      "rmse_dy": 0.012999065220355988,
      "rmse_mean": 0.03125382959842682,
      "rotation_flip": 0.014897579327225685,
      "sparse_tokens": 8616.0,
      "step": 1087,
      "turn_loss": 0.2821688950061798,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.050548225236944806,
      "grad_norm": 0.6376592516899109,
      "learning_rate": 9.837410707675721e-06,
      "loss": 0.2069,
      "mae_dtheta": 0.012487025000154972,
      "mae_dx": 0.003362558549270034,
      "mae_dy": 0.0043287319131195545,
      "pose_mae_dtheta": 0.08398857712745667,
      "pose_mae_dx": 0.04420481249690056,
      "pose_mae_dy": 0.041208524256944656,
      "pose_rmse_dtheta": 0.15239566564559937,
      "pose_rmse_dx": 0.11507730185985565,
      "pose_rmse_dy": 0.09040891379117966,
      "pose_rmse_mean": 0.11929397284984589,
      "rmse_dtheta": 0.022545041516423225,
      "rmse_dx": 0.00981728546321392,
      "rmse_dy": 0.009871532209217548,
      "rmse_mean": 0.014077953062951565,
      "rotation_flip": 0.006727211643010378,
      "sparse_tokens": 32105.0,
      "step": 1088,
      "turn_loss": 0.13392695784568787,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05059468500278758,
      "grad_norm": 0.6492615342140198,
      "learning_rate": 9.83707609731432e-06,
      "loss": 0.1715,
      "mae_dtheta": 0.012629427015781403,
      "mae_dx": 0.0030475379899144173,
      "mae_dy": 0.003072878113016486,
      "pose_mae_dtheta": 0.09253905713558197,
      "pose_mae_dx": 0.03252500668168068,
      "pose_mae_dy": 0.0379704087972641,
      "pose_rmse_dtheta": 0.23312081396579742,
      "pose_rmse_dx": 0.09506208449602127,
      "pose_rmse_dy": 0.10267889499664307,
      "pose_rmse_mean": 0.14362061023712158,
      "rmse_dtheta": 0.026819303631782532,
      "rmse_dx": 0.010157537646591663,
      "rmse_dy": 0.007601628545671701,
      "rmse_mean": 0.014859490096569061,
      "rotation_flip": 0.0038527396973222494,
      "sparse_tokens": 32089.0,
      "step": 1089,
      "turn_loss": 0.11660648882389069,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.05064114476863037,
      "grad_norm": 0.5055153369903564,
      "learning_rate": 9.836741148693592e-06,
      "loss": 0.1287,
      "mae_dtheta": 0.015690280124545097,
      "mae_dx": 0.0021460612770169973,
      "mae_dy": 0.003338549518957734,
      "pose_mae_dtheta": 0.10990148037672043,
      "pose_mae_dx": 0.035703547298908234,
      "pose_mae_dy": 0.04435255751013756,
      "pose_rmse_dtheta": 0.26619964838027954,
      "pose_rmse_dx": 0.08251958340406418,
      "pose_rmse_dy": 0.10615400969982147,
      "pose_rmse_mean": 0.1516244262456894,
      "rmse_dtheta": 0.030555689707398415,
      "rmse_dx": 0.005568395834416151,
      "rmse_dy": 0.0064722392708063126,
      "rmse_mean": 0.01419877540320158,
      "rotation_flip": 0.007246376946568489,
      "sparse_tokens": 32121.0,
      "step": 1090,
      "turn_loss": 0.10371191799640656,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26609.0,
      "epoch": 0.050687604534473144,
      "grad_norm": 0.4751410484313965,
      "learning_rate": 9.836405861836957e-06,
      "loss": 0.1569,
      "mae_dtheta": 0.03786070644855499,
      "mae_dx": 0.010844879783689976,
      "mae_dy": 0.004933610092848539,
      "pose_mae_dtheta": 0.3097873628139496,
      "pose_mae_dx": 0.09064570814371109,
      "pose_mae_dy": 0.055472809821367264,
      "pose_rmse_dtheta": 0.5303335189819336,
      "pose_rmse_dx": 0.21749347448349,
      "pose_rmse_dy": 0.13804207742214203,
      "pose_rmse_mean": 0.29528969526290894,
      "rmse_dtheta": 0.05595415458083153,
      "rmse_dx": 0.0233570858836174,
      "rmse_dy": 0.010567210614681244,
      "rmse_mean": 0.029959483072161674,
      "rotation_flip": 0.014319809153676033,
      "sparse_tokens": 20185.0,
      "step": 1091,
      "turn_loss": 0.2735775411128998,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.05073406430031593,
      "grad_norm": 0.6481091976165771,
      "learning_rate": 9.836070236767866e-06,
      "loss": 0.1455,
      "mae_dtheta": 0.01525587122887373,
      "mae_dx": 0.004357148893177509,
      "mae_dy": 0.005533301271498203,
      "pose_mae_dtheta": 0.11590058356523514,
      "pose_mae_dx": 0.04237346351146698,
      "pose_mae_dy": 0.06478681415319443,
      "pose_rmse_dtheta": 0.2830570638179779,
      "pose_rmse_dx": 0.11888076364994049,
      "pose_rmse_dy": 0.23012007772922516,
      "pose_rmse_mean": 0.21068596839904785,
      "rmse_dtheta": 0.03131907805800438,
      "rmse_dx": 0.01273336075246334,
      "rmse_dy": 0.01790478639304638,
      "rmse_mean": 0.0206524096429348,
      "rotation_flip": 0.008130080997943878,
      "sparse_tokens": 32105.0,
      "step": 1092,
      "turn_loss": 0.16961704194545746,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.050780524066158704,
      "grad_norm": 0.3868883550167084,
      "learning_rate": 9.835734273509787e-06,
      "loss": 0.1226,
      "mae_dtheta": 0.04343881830573082,
      "mae_dx": 0.011497053317725658,
      "mae_dy": 0.004224131815135479,
      "pose_mae_dtheta": 0.32711437344551086,
      "pose_mae_dx": 0.09688695520162582,
      "pose_mae_dy": 0.04169848933815956,
      "pose_rmse_dtheta": 0.5735649466514587,
      "pose_rmse_dx": 0.20313295722007751,
      "pose_rmse_dy": 0.09384960681200027,
      "pose_rmse_mean": 0.290182501077652,
      "rmse_dtheta": 0.06391528248786926,
      "rmse_dx": 0.02293616533279419,
      "rmse_dy": 0.00866908673197031,
      "rmse_mean": 0.03184017911553383,
      "rotation_flip": 0.011774600483477116,
      "sparse_tokens": 20570.0,
      "step": 1093,
      "turn_loss": 0.2845692038536072,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.05082698383200149,
      "grad_norm": 0.6169286966323853,
      "learning_rate": 9.835397972086214e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.028859863057732582,
      "mae_dx": 0.011493473313748837,
      "mae_dy": 0.003822903148829937,
      "pose_mae_dtheta": 0.2032262235879898,
      "pose_mae_dx": 0.09111224114894867,
      "pose_mae_dy": 0.03948593512177467,
      "pose_rmse_dtheta": 0.3666107952594757,
      "pose_rmse_dx": 0.21381287276744843,
      "pose_rmse_dy": 0.10328007489442825,
      "pose_rmse_mean": 0.22790125012397766,
      "rmse_dtheta": 0.045990005135536194,
      "rmse_dx": 0.02401038631796837,
      "rmse_dy": 0.008586915209889412,
      "rmse_mean": 0.026195770129561424,
      "rotation_flip": 0.017142856493592262,
      "sparse_tokens": 14956.0,
      "step": 1094,
      "turn_loss": 0.20146465301513672,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.050873443597844265,
      "grad_norm": 0.4792279303073883,
      "learning_rate": 9.835061332520666e-06,
      "loss": 0.0924,
      "mae_dtheta": 0.023522112518548965,
      "mae_dx": 0.00598260760307312,
      "mae_dy": 0.005154050420969725,
      "pose_mae_dtheta": 0.20575158298015594,
      "pose_mae_dx": 0.05593559890985489,
      "pose_mae_dy": 0.04565053433179855,
      "pose_rmse_dtheta": 0.4179162383079529,
      "pose_rmse_dx": 0.108351930975914,
      "pose_rmse_dy": 0.08775880187749863,
      "pose_rmse_mean": 0.20467565953731537,
      "rmse_dtheta": 0.041795190423727036,
      "rmse_dx": 0.011996150948107243,
      "rmse_dy": 0.009198521263897419,
      "rmse_mean": 0.020996620878577232,
      "rotation_flip": 0.011267605237662792,
      "sparse_tokens": 6730.0,
      "step": 1095,
      "turn_loss": 0.18906345963478088,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.05091990336368705,
      "grad_norm": 0.5421193838119507,
      "learning_rate": 9.834724354836684e-06,
      "loss": 0.0942,
      "mae_dtheta": 0.012377494014799595,
      "mae_dx": 0.0026650631334632635,
      "mae_dy": 0.002055815886706114,
      "pose_mae_dtheta": 0.08593125641345978,
      "pose_mae_dx": 0.026326877996325493,
      "pose_mae_dy": 0.023180561140179634,
      "pose_rmse_dtheta": 0.22921222448349,
      "pose_rmse_dx": 0.06306587159633636,
      "pose_rmse_dy": 0.061240509152412415,
      "pose_rmse_mean": 0.11783953756093979,
      "rmse_dtheta": 0.029010538011789322,
      "rmse_dx": 0.006957388948649168,
      "rmse_dy": 0.0051183560863137245,
      "rmse_mean": 0.013695428147912025,
      "rotation_flip": 0.0051587303169071674,
      "sparse_tokens": 32233.0,
      "step": 1096,
      "turn_loss": 0.08978800475597382,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.050966363129529825,
      "grad_norm": 0.64323890209198,
      "learning_rate": 9.834387039057834e-06,
      "loss": 0.1461,
      "mae_dtheta": 0.024682367220520973,
      "mae_dx": 0.010148516856133938,
      "mae_dy": 0.006582622416317463,
      "pose_mae_dtheta": 0.1592596173286438,
      "pose_mae_dx": 0.08095954358577728,
      "pose_mae_dy": 0.08574479818344116,
      "pose_rmse_dtheta": 0.2666410505771637,
      "pose_rmse_dx": 0.16485200822353363,
      "pose_rmse_dy": 0.18154802918434143,
      "pose_rmse_mean": 0.20434701442718506,
      "rmse_dtheta": 0.03722579777240753,
      "rmse_dx": 0.021491268649697304,
      "rmse_dy": 0.011775514110922813,
      "rmse_mean": 0.023497527465224266,
      "rotation_flip": 0.0038910505827516317,
      "sparse_tokens": 5372.0,
      "step": 1097,
      "turn_loss": 0.24760909378528595,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.05101282289537261,
      "grad_norm": 0.5905277729034424,
      "learning_rate": 9.834049385207703e-06,
      "loss": 0.1709,
      "mae_dtheta": 0.014506879262626171,
      "mae_dx": 0.001998431049287319,
      "mae_dy": 0.0032111189793795347,
      "pose_mae_dtheta": 0.10069561004638672,
      "pose_mae_dx": 0.030972272157669067,
      "pose_mae_dy": 0.04764533415436745,
      "pose_rmse_dtheta": 0.21122150123119354,
      "pose_rmse_dx": 0.08007126301527023,
      "pose_rmse_dy": 0.11995291709899902,
      "pose_rmse_mean": 0.13708189129829407,
      "rmse_dtheta": 0.02791103906929493,
      "rmse_dx": 0.006282288581132889,
      "rmse_dy": 0.006511144805699587,
      "rmse_mean": 0.013568158261477947,
      "rotation_flip": 0.008333333767950535,
      "sparse_tokens": 32041.0,
      "step": 1098,
      "turn_loss": 0.1242636889219284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.051059282661215386,
      "grad_norm": 0.43314328789711,
      "learning_rate": 9.833711393309902e-06,
      "loss": 0.1104,
      "mae_dtheta": 0.010676756501197815,
      "mae_dx": 0.0021585270296782255,
      "mae_dy": 0.0013887496897950768,
      "pose_mae_dtheta": 0.08409012854099274,
      "pose_mae_dx": 0.02081194892525673,
      "pose_mae_dy": 0.01912306249141693,
      "pose_rmse_dtheta": 0.25457289814949036,
      "pose_rmse_dx": 0.056512683629989624,
      "pose_rmse_dy": 0.048016224056482315,
      "pose_rmse_mean": 0.1197006031870842,
      "rmse_dtheta": 0.028244243934750557,
      "rmse_dx": 0.0069493395276367664,
      "rmse_dy": 0.0033951743971556425,
      "rmse_mean": 0.012862919829785824,
      "rotation_flip": 0.004315659869462252,
      "sparse_tokens": 32089.0,
      "step": 1099,
      "turn_loss": 0.08092226833105087,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.05110574242705817,
      "grad_norm": 0.5811084508895874,
      "learning_rate": 9.83337306338807e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.012882782146334648,
      "mae_dx": 0.0026002873200923204,
      "mae_dy": 0.0030438017565757036,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5811083316802979,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 137.20394897460938,
      "model/head/act_norm_mean": 103.93386994949495,
      "model/head/act_norm_min": 65.6971206665039,
      "model/head/act_over_embed": 71.42432847351395,
      "model/head/grad_frac": 0.1188090443611145,
      "model/head/grad_norm": 0.0690409243106842,
      "model/head/grad_zero_frac": 0.0001595876965438947,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6817836568813131,
      "model/head/update_ratio": 0.0012036022963002324,
      "model/head/weight_delta": 3.6917006969451904,
      "model/head/weight_delta_rel": 0.06476336717605591,
      "model/head/weight_norm": 57.361907958984375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4119565188884735,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4118877893972605,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4118310809135437,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28305314502803647,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0685248002409935,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03982033208012581,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5229939956331878,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012973385164514184,
      "model/modality_embedder.encoders.pose/weight_delta": 1.1617759466171265,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.037958841770887375,
      "model/modality_embedder.encoders.pose/weight_norm": 30.693862915039062,
      "model/modality_embedder/grad_frac": 0.0685248002409935,
      "model/modality_embedder/grad_norm": 0.03982033208012581,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5229939956331878,
      "model/modality_embedder/update_ratio": 0.0012973385164514184,
      "model/modality_embedder/weight_delta": 1.1617759466171265,
      "model/modality_embedder/weight_delta_rel": 0.037958841770887375,
      "model/modality_embedder/weight_norm": 30.693862915039062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.00932312011719,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.78166085457752,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.084847450256348,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.655770624534957,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09283728897571564,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05394852161407471,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019597571808844805,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.6104486584663391,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.022245118394494057,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.528165817260742,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.48548126220703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.892609126984127,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.358976364135742,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.41922467819437,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0951748788356781,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05530691519379616,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019052536226809025,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.7444021105766296,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.02578667178750038,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.028636932373047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.26641845703125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.873614618406286,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.604534149169922,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.780590198365296,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09617438912391663,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05588774010539055,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018658132757991552,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.7791159152984619,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.026161253452301025,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.953554153442383,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.201416015625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.78042578563412,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.472883224487305,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.09096868433167,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10657215863466263,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06192997097969055,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0021074654068797827,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.6606930494308472,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.02257935330271721,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.385995864868164,
      "model/normalizer/grad_frac": 0.3852335810661316,
      "model/normalizer/grad_norm": 0.2238624393939972,
      "model/normalizer/grad_zero_frac": 0.0001654433726798743,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002876546001061797,
      "model/normalizer/weight_delta": 1.4391998052597046,
      "model/normalizer/weight_delta_rel": 0.01853606104850769,
      "model/normalizer/weight_norm": 77.82334899902344,
      "pose_mae_dtheta": 0.08792859315872192,
      "pose_mae_dx": 0.029783498495817184,
      "pose_mae_dy": 0.032593969255685806,
      "pose_rmse_dtheta": 0.19776585698127747,
      "pose_rmse_dx": 0.06514093279838562,
      "pose_rmse_dy": 0.08164497464895248,
      "pose_rmse_mean": 0.11485059559345245,
      "rmse_dtheta": 0.025935566052794456,
      "rmse_dx": 0.007529243361204863,
      "rmse_dy": 0.007066168822348118,
      "rmse_mean": 0.01351032592356205,
      "rotation_flip": 0.005832793191075325,
      "sparse_tokens": 32153.0,
      "step": 1100,
      "turn_loss": 0.10274113714694977,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.051152202192900946,
      "grad_norm": 0.5206092596054077,
      "learning_rate": 9.833034395465866e-06,
      "loss": 0.107,
      "mae_dtheta": 0.012054701335728168,
      "mae_dx": 0.002645755186676979,
      "mae_dy": 0.002547023119404912,
      "pose_mae_dtheta": 0.08667651563882828,
      "pose_mae_dx": 0.022992640733718872,
      "pose_mae_dy": 0.029831968247890472,
      "pose_rmse_dtheta": 0.22703637182712555,
      "pose_rmse_dx": 0.05725330486893654,
      "pose_rmse_dy": 0.0698726549744606,
      "pose_rmse_mean": 0.1180541142821312,
      "rmse_dtheta": 0.02652943693101406,
      "rmse_dx": 0.008233764208853245,
      "rmse_dy": 0.006732084322720766,
      "rmse_mean": 0.013831762596964836,
      "rotation_flip": 0.008244022727012634,
      "sparse_tokens": 32137.0,
      "step": 1101,
      "turn_loss": 0.09422104805707932,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.05119866195874373,
      "grad_norm": 0.4209795296192169,
      "learning_rate": 9.832695389566973e-06,
      "loss": 0.1471,
      "mae_dtheta": 0.04056555777788162,
      "mae_dx": 0.01325823925435543,
      "mae_dy": 0.0067121428437530994,
      "pose_mae_dtheta": 0.29398274421691895,
      "pose_mae_dx": 0.09965836256742477,
      "pose_mae_dy": 0.06663917005062103,
      "pose_rmse_dtheta": 0.4971616864204407,
      "pose_rmse_dx": 0.22709202766418457,
      "pose_rmse_dy": 0.16192148625850677,
      "pose_rmse_mean": 0.2953917384147644,
      "rmse_dtheta": 0.058155886828899384,
      "rmse_dx": 0.02683062106370926,
      "rmse_dy": 0.014773055911064148,
      "rmse_mean": 0.03325318917632103,
      "rotation_flip": 0.011029412038624287,
      "sparse_tokens": 8787.0,
      "step": 1102,
      "turn_loss": 0.3131689429283142,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.051245121724586506,
      "grad_norm": 0.5734164118766785,
      "learning_rate": 9.832356045715097e-06,
      "loss": 0.1473,
      "mae_dtheta": 0.010796578601002693,
      "mae_dx": 0.0017538402462378144,
      "mae_dy": 0.0018676983891054988,
      "pose_mae_dtheta": 0.0752975270152092,
      "pose_mae_dx": 0.02392876148223877,
      "pose_mae_dy": 0.028311515226960182,
      "pose_rmse_dtheta": 0.20315687358379364,
      "pose_rmse_dx": 0.055626071989536285,
      "pose_rmse_dy": 0.08449886739253998,
      "pose_rmse_mean": 0.11442726850509644,
      "rmse_dtheta": 0.02594008296728134,
      "rmse_dx": 0.00484333885833621,
      "rmse_dy": 0.00437312014400959,
      "rmse_mean": 0.01171884685754776,
      "rotation_flip": 0.006717420648783445,
      "sparse_tokens": 32121.0,
      "step": 1103,
      "turn_loss": 0.08550049364566803,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9731.0,
      "epoch": 0.05129158149042929,
      "grad_norm": 1.075289011001587,
      "learning_rate": 9.83201636393397e-06,
      "loss": 0.2646,
      "mae_dtheta": 0.0438854955136776,
      "mae_dx": 0.014084205962717533,
      "mae_dy": 0.005098036024719477,
      "pose_mae_dtheta": 0.4018862843513489,
      "pose_mae_dx": 0.1239452138543129,
      "pose_mae_dy": 0.0675276517868042,
      "pose_rmse_dtheta": 0.6406134963035583,
      "pose_rmse_dx": 0.22768399119377136,
      "pose_rmse_dy": 0.16054747998714447,
      "pose_rmse_mean": 0.342948317527771,
      "rmse_dtheta": 0.06221671402454376,
      "rmse_dx": 0.025444595143198967,
      "rmse_dy": 0.009010748006403446,
      "rmse_mean": 0.03222402185201645,
      "rotation_flip": 0.014705882407724857,
      "sparse_tokens": 8175.0,
      "step": 1104,
      "turn_loss": 0.33174365758895874,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05133804125627207,
      "grad_norm": 0.4338589608669281,
      "learning_rate": 9.831676344247343e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.010529102757573128,
      "mae_dx": 0.0019008178496733308,
      "mae_dy": 0.0025849821977317333,
      "pose_mae_dtheta": 0.07834995537996292,
      "pose_mae_dx": 0.027154849842190742,
      "pose_mae_dy": 0.03379226103425026,
      "pose_rmse_dtheta": 0.15890994668006897,
      "pose_rmse_dx": 0.07638610154390335,
      "pose_rmse_dy": 0.08180417865514755,
      "pose_rmse_mean": 0.10570007562637329,
      "rmse_dtheta": 0.020823495462536812,
      "rmse_dx": 0.006054214667528868,
      "rmse_dy": 0.005906253587454557,
      "rmse_mean": 0.010927988216280937,
      "rotation_flip": 0.0038804812356829643,
      "sparse_tokens": 32089.0,
      "step": 1105,
      "turn_loss": 0.09654682874679565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.05138450102211485,
      "grad_norm": 1.2211289405822754,
      "learning_rate": 9.831335986678998e-06,
      "loss": 0.3198,
      "mae_dtheta": 0.02666199579834938,
      "mae_dx": 0.004637888632714748,
      "mae_dy": 0.005308711435645819,
      "pose_mae_dtheta": 0.17746002972126007,
      "pose_mae_dx": 0.04760178178548813,
      "pose_mae_dy": 0.0757816880941391,
      "pose_rmse_dtheta": 0.3464406728744507,
      "pose_rmse_dx": 0.11942114681005478,
      "pose_rmse_dy": 0.14892229437828064,
      "pose_rmse_mean": 0.20492804050445557,
      "rmse_dtheta": 0.04367370158433914,
      "rmse_dx": 0.014087064191699028,
      "rmse_dy": 0.00915744062513113,
      "rmse_mean": 0.02230606973171234,
      "rotation_flip": 0.0076530613005161285,
      "sparse_tokens": 6663.0,
      "step": 1106,
      "turn_loss": 0.21866197884082794,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.05143096078795763,
      "grad_norm": 1.0582479238510132,
      "learning_rate": 9.830995291252732e-06,
      "loss": 0.3238,
      "mae_dtheta": 0.029834773391485214,
      "mae_dx": 0.009891928173601627,
      "mae_dy": 0.00726113049313426,
      "pose_mae_dtheta": 0.2196354866027832,
      "pose_mae_dx": 0.11071641743183136,
      "pose_mae_dy": 0.12444393336772919,
      "pose_rmse_dtheta": 0.3327007293701172,
      "pose_rmse_dx": 0.24225690960884094,
      "pose_rmse_dy": 0.215443417429924,
      "pose_rmse_mean": 0.263467013835907,
      "rmse_dtheta": 0.04286745935678482,
      "rmse_dx": 0.02353997528553009,
      "rmse_dy": 0.011679100804030895,
      "rmse_mean": 0.026028845459222794,
      "rotation_flip": 0.01224489789456129,
      "sparse_tokens": 9750.0,
      "step": 1107,
      "turn_loss": 0.2448568046092987,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05147742055380041,
      "grad_norm": 0.44174081087112427,
      "learning_rate": 9.830654257992375e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.011627956293523312,
      "mae_dx": 0.002378847450017929,
      "mae_dy": 0.0024669927079230547,
      "pose_mae_dtheta": 0.08319643884897232,
      "pose_mae_dx": 0.02882377803325653,
      "pose_mae_dy": 0.03198094666004181,
      "pose_rmse_dtheta": 0.21178476512432098,
      "pose_rmse_dx": 0.08123070001602173,
      "pose_rmse_dy": 0.08244252949953079,
      "pose_rmse_mean": 0.12515267729759216,
      "rmse_dtheta": 0.027637315914034843,
      "rmse_dx": 0.008166688494384289,
      "rmse_dy": 0.006230406928807497,
      "rmse_mean": 0.014011470600962639,
      "rotation_flip": 0.0033191086258739233,
      "sparse_tokens": 32089.0,
      "step": 1108,
      "turn_loss": 0.09338856488466263,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.05152388031964319,
      "grad_norm": 0.38630568981170654,
      "learning_rate": 9.830312886921771e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.01041265856474638,
      "mae_dx": 0.0024879227858036757,
      "mae_dy": 0.0025766186881810427,
      "pose_mae_dtheta": 0.07950957119464874,
      "pose_mae_dx": 0.03309456631541252,
      "pose_mae_dy": 0.03001667559146881,
      "pose_rmse_dtheta": 0.19006171822547913,
      "pose_rmse_dx": 0.09381911903619766,
      "pose_rmse_dy": 0.07415060698986053,
      "pose_rmse_mean": 0.1193438172340393,
      "rmse_dtheta": 0.02366938441991806,
      "rmse_dx": 0.007013326045125723,
      "rmse_dy": 0.006075204350054264,
      "rmse_mean": 0.012252639047801495,
      "rotation_flip": 0.006405123975127935,
      "sparse_tokens": 32121.0,
      "step": 1109,
      "turn_loss": 0.08295076340436935,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05157034008548597,
      "grad_norm": 0.8186149001121521,
      "learning_rate": 9.829971178064794e-06,
      "loss": 0.1814,
      "mae_dtheta": 0.010947532951831818,
      "mae_dx": 0.0022231501061469316,
      "mae_dy": 0.0017430164152756333,
      "pose_mae_dtheta": 0.07737771421670914,
      "pose_mae_dx": 0.02435987815260887,
      "pose_mae_dy": 0.02990439347922802,
      "pose_rmse_dtheta": 0.1977865993976593,
      "pose_rmse_dx": 0.06561015546321869,
      "pose_rmse_dy": 0.06960742920637131,
      "pose_rmse_mean": 0.1110013946890831,
      "rmse_dtheta": 0.023620087653398514,
      "rmse_dx": 0.007537283468991518,
      "rmse_dy": 0.0032680637668818235,
      "rmse_mean": 0.011475144885480404,
      "rotation_flip": 0.0031298904214054346,
      "sparse_tokens": 32089.0,
      "step": 1110,
      "turn_loss": 0.08533240854740143,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.05161679985132875,
      "grad_norm": 0.6416556239128113,
      "learning_rate": 9.829629131445342e-06,
      "loss": 0.1534,
      "mae_dtheta": 0.041526999324560165,
      "mae_dx": 0.015668228268623352,
      "mae_dy": 0.0038692266680300236,
      "pose_mae_dtheta": 0.344835489988327,
      "pose_mae_dx": 0.1377868801355362,
      "pose_mae_dy": 0.05562971159815788,
      "pose_rmse_dtheta": 0.5688562989234924,
      "pose_rmse_dx": 0.2829132676124573,
      "pose_rmse_dy": 0.12064139544963837,
      "pose_rmse_mean": 0.32413700222969055,
      "rmse_dtheta": 0.05996324121952057,
      "rmse_dx": 0.02897515892982483,
      "rmse_dy": 0.007162043359130621,
      "rmse_mean": 0.03203348070383072,
      "rotation_flip": 0.016355140134692192,
      "sparse_tokens": 14343.0,
      "step": 1111,
      "turn_loss": 0.25260353088378906,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.05166325961717153,
      "grad_norm": 0.7107040286064148,
      "learning_rate": 9.829286747087333e-06,
      "loss": 0.1864,
      "mae_dtheta": 0.039955005049705505,
      "mae_dx": 0.004647813271731138,
      "mae_dy": 0.004189745988696814,
      "pose_mae_dtheta": 0.3002672791481018,
      "pose_mae_dx": 0.014046551659703255,
      "pose_mae_dy": 0.027071287855505943,
      "pose_rmse_dtheta": 0.6237208843231201,
      "pose_rmse_dx": 0.03715849667787552,
      "pose_rmse_dy": 0.061280906200408936,
      "pose_rmse_mean": 0.24072009325027466,
      "rmse_dtheta": 0.06565726548433304,
      "rmse_dx": 0.010565903037786484,
      "rmse_dy": 0.00826811883598566,
      "rmse_mean": 0.028163760900497437,
      "rotation_flip": 0.005586592014878988,
      "sparse_tokens": 2889.0,
      "step": 1112,
      "turn_loss": 0.2762518525123596,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.05170971938301431,
      "grad_norm": 0.5060136914253235,
      "learning_rate": 9.828944025014708e-06,
      "loss": 0.1938,
      "mae_dtheta": 0.03951337933540344,
      "mae_dx": 0.010841622948646545,
      "mae_dy": 0.008588934317231178,
      "pose_mae_dtheta": 0.3280037045478821,
      "pose_mae_dx": 0.09944889694452286,
      "pose_mae_dy": 0.09602049738168716,
      "pose_rmse_dtheta": 0.5323198437690735,
      "pose_rmse_dx": 0.19643370807170868,
      "pose_rmse_dy": 0.19453741610050201,
      "pose_rmse_mean": 0.3077636659145355,
      "rmse_dtheta": 0.05644848197698593,
      "rmse_dx": 0.020961714908480644,
      "rmse_dy": 0.016124075278639793,
      "rmse_mean": 0.03117809258401394,
      "rotation_flip": 0.014084506779909134,
      "sparse_tokens": 14523.0,
      "step": 1113,
      "turn_loss": 0.3029095232486725,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.05175617914885709,
      "grad_norm": 0.7809010148048401,
      "learning_rate": 9.828600965251436e-06,
      "loss": 0.1861,
      "mae_dtheta": 0.04569423943758011,
      "mae_dx": 0.014291208237409592,
      "mae_dy": 0.007079169619828463,
      "pose_mae_dtheta": 0.3904305100440979,
      "pose_mae_dx": 0.11820259690284729,
      "pose_mae_dy": 0.07205847650766373,
      "pose_rmse_dtheta": 0.5755472779273987,
      "pose_rmse_dx": 0.2388162910938263,
      "pose_rmse_dy": 0.15544697642326355,
      "pose_rmse_mean": 0.32327020168304443,
      "rmse_dtheta": 0.06297951936721802,
      "rmse_dx": 0.02625781111419201,
      "rmse_dy": 0.015668023377656937,
      "rmse_mean": 0.03496845066547394,
      "rotation_flip": 0.03179650381207466,
      "sparse_tokens": 9692.0,
      "step": 1114,
      "turn_loss": 0.4225321114063263,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.05180263891469987,
      "grad_norm": 0.6806185841560364,
      "learning_rate": 9.828257567821507e-06,
      "loss": 0.1501,
      "mae_dtheta": 0.041943296790122986,
      "mae_dx": 0.020991677418351173,
      "mae_dy": 0.011466626077890396,
      "pose_mae_dtheta": 0.34293240308761597,
      "pose_mae_dx": 0.2092471718788147,
      "pose_mae_dy": 0.15115809440612793,
      "pose_rmse_dtheta": 0.528704047203064,
      "pose_rmse_dx": 0.3773362636566162,
      "pose_rmse_dy": 0.2670450806617737,
      "pose_rmse_mean": 0.391028493642807,
      "rmse_dtheta": 0.05711111053824425,
      "rmse_dx": 0.03473040834069252,
      "rmse_dy": 0.02216252312064171,
      "rmse_mean": 0.038001351058483124,
      "rotation_flip": 0.011709601618349552,
      "sparse_tokens": 8393.0,
      "step": 1115,
      "turn_loss": 0.4423690736293793,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.05184909868054265,
      "grad_norm": 0.42561596632003784,
      "learning_rate": 9.827913832748933e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.012736743316054344,
      "mae_dx": 0.0020708960946649313,
      "mae_dy": 0.0025612746831029654,
      "pose_mae_dtheta": 0.09220725297927856,
      "pose_mae_dx": 0.0239508468657732,
      "pose_mae_dy": 0.027433978393673897,
      "pose_rmse_dtheta": 0.23703761398792267,
      "pose_rmse_dx": 0.05760594457387924,
      "pose_rmse_dy": 0.054721057415008545,
      "pose_rmse_mean": 0.11645486950874329,
      "rmse_dtheta": 0.028522314503788948,
      "rmse_dx": 0.006614102050662041,
      "rmse_dy": 0.005847885739058256,
      "rmse_mean": 0.01366143487393856,
      "rotation_flip": 0.0035742653999477625,
      "sparse_tokens": 32073.0,
      "step": 1116,
      "turn_loss": 0.08055821061134338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.05189555844638543,
      "grad_norm": 0.4509270489215851,
      "learning_rate": 9.827569760057755e-06,
      "loss": 0.1236,
      "mae_dtheta": 0.01724584586918354,
      "mae_dx": 0.003605511737987399,
      "mae_dy": 0.003718938212841749,
      "pose_mae_dtheta": 0.12434063106775284,
      "pose_mae_dx": 0.039834506809711456,
      "pose_mae_dy": 0.04495926573872566,
      "pose_rmse_dtheta": 0.29102662205696106,
      "pose_rmse_dx": 0.10226009786128998,
      "pose_rmse_dy": 0.12369676679372787,
      "pose_rmse_mean": 0.17232781648635864,
      "rmse_dtheta": 0.03505951911211014,
      "rmse_dx": 0.009850088506937027,
      "rmse_dy": 0.00956876389682293,
      "rmse_mean": 0.01815945655107498,
      "rotation_flip": 0.00498398020863533,
      "sparse_tokens": 32169.0,
      "step": 1117,
      "turn_loss": 0.14187484979629517,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20712.0,
      "epoch": 0.051942018212228214,
      "grad_norm": 0.5022947192192078,
      "learning_rate": 9.827225349772033e-06,
      "loss": 0.1625,
      "mae_dtheta": 0.03925437852740288,
      "mae_dx": 0.015570340678095818,
      "mae_dy": 0.005203606560826302,
      "pose_mae_dtheta": 0.3191758990287781,
      "pose_mae_dx": 0.1285419464111328,
      "pose_mae_dy": 0.07947587221860886,
      "pose_rmse_dtheta": 0.5857076644897461,
      "pose_rmse_dx": 0.2792864441871643,
      "pose_rmse_dy": 0.16805773973464966,
      "pose_rmse_mean": 0.3443506360054016,
      "rmse_dtheta": 0.0582280270755291,
      "rmse_dx": 0.02951093576848507,
      "rmse_dy": 0.009428638033568859,
      "rmse_mean": 0.03238920122385025,
      "rotation_flip": 0.00972972996532917,
      "sparse_tokens": 16548.0,
      "step": 1118,
      "turn_loss": 0.2734878659248352,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 27254.0,
      "epoch": 0.05198847797807099,
      "grad_norm": 0.5105368494987488,
      "learning_rate": 9.82688060191585e-06,
      "loss": 0.1733,
      "mae_dtheta": 0.027790237218141556,
      "mae_dx": 0.01083272323012352,
      "mae_dy": 0.008058317936956882,
      "pose_mae_dtheta": 0.20949304103851318,
      "pose_mae_dx": 0.10031920671463013,
      "pose_mae_dy": 0.09390094876289368,
      "pose_rmse_dtheta": 0.3635347783565521,
      "pose_rmse_dx": 0.21308445930480957,
      "pose_rmse_dy": 0.1969212144613266,
      "pose_rmse_mean": 0.2578468322753906,
      "rmse_dtheta": 0.042635176330804825,
      "rmse_dx": 0.0218668095767498,
      "rmse_dy": 0.016450002789497375,
      "rmse_mean": 0.026983996853232384,
      "rotation_flip": 0.016067329794168472,
      "sparse_tokens": 21735.0,
      "step": 1119,
      "turn_loss": 0.3148130774497986,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.05203493774391377,
      "grad_norm": 0.6944310665130615,
      "learning_rate": 9.826535516513318e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.012538143433630466,
      "mae_dx": 0.003950734157115221,
      "mae_dy": 0.003987340722233057,
      "pose_mae_dtheta": 0.09754420071840286,
      "pose_mae_dx": 0.04098957031965256,
      "pose_mae_dy": 0.03913242742419243,
      "pose_rmse_dtheta": 0.2279444932937622,
      "pose_rmse_dx": 0.11495468020439148,
      "pose_rmse_dy": 0.14261920750141144,
      "pose_rmse_mean": 0.16183947026729584,
      "rmse_dtheta": 0.025712374597787857,
      "rmse_dx": 0.011141888797283173,
      "rmse_dy": 0.012862063013017178,
      "rmse_mean": 0.01657211035490036,
      "rotation_flip": 0.0047003524377942085,
      "sparse_tokens": 32137.0,
      "step": 1120,
      "turn_loss": 0.14414232969284058,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.05208139750975655,
      "grad_norm": 0.6222120523452759,
      "learning_rate": 9.826190093588564e-06,
      "loss": 0.0962,
      "mae_dtheta": 0.009945748373866081,
      "mae_dx": 0.0014900650130584836,
      "mae_dy": 0.0019847266376018524,
      "pose_mae_dtheta": 0.06836128979921341,
      "pose_mae_dx": 0.021393131464719772,
      "pose_mae_dy": 0.026968365535140038,
      "pose_rmse_dtheta": 0.19980452954769135,
      "pose_rmse_dx": 0.05792434141039848,
      "pose_rmse_dy": 0.06709843873977661,
      "pose_rmse_mean": 0.10827577114105225,
      "rmse_dtheta": 0.023942790925502777,
      "rmse_dx": 0.00444978941231966,
      "rmse_dy": 0.004776378627866507,
      "rmse_mean": 0.011056318879127502,
      "rotation_flip": 0.008877052925527096,
      "sparse_tokens": 32073.0,
      "step": 1121,
      "turn_loss": 0.06930606067180634,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05212785727559933,
      "grad_norm": 0.5135683417320251,
      "learning_rate": 9.825844333165748e-06,
      "loss": 0.1423,
      "mae_dtheta": 0.014310844242572784,
      "mae_dx": 0.0023081148974597454,
      "mae_dy": 0.003278053132817149,
      "pose_mae_dtheta": 0.09437856823205948,
      "pose_mae_dx": 0.03379293531179428,
      "pose_mae_dy": 0.04475041851401329,
      "pose_rmse_dtheta": 0.1852499395608902,
      "pose_rmse_dx": 0.08059082180261612,
      "pose_rmse_dy": 0.10676676779985428,
      "pose_rmse_mean": 0.12420251220464706,
      "rmse_dtheta": 0.025419414043426514,
      "rmse_dx": 0.006617120001465082,
      "rmse_dy": 0.007018817588686943,
      "rmse_mean": 0.013018451631069183,
      "rotation_flip": 0.011666059494018555,
      "sparse_tokens": 32089.0,
      "step": 1122,
      "turn_loss": 0.1122765988111496,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.05217431704144211,
      "grad_norm": 0.8189716339111328,
      "learning_rate": 9.825498235269046e-06,
      "loss": 0.2518,
      "mae_dtheta": 0.03907204046845436,
      "mae_dx": 0.011558061465620995,
      "mae_dy": 0.007326270453631878,
      "pose_mae_dtheta": 0.30637505650520325,
      "pose_mae_dx": 0.08613279461860657,
      "pose_mae_dy": 0.0756136029958725,
      "pose_rmse_dtheta": 0.5061107277870178,
      "pose_rmse_dx": 0.17363207042217255,
      "pose_rmse_dy": 0.14001356065273285,
      "pose_rmse_mean": 0.27325212955474854,
      "rmse_dtheta": 0.05649758130311966,
      "rmse_dx": 0.021857850253582,
      "rmse_dy": 0.01440158486366272,
      "rmse_mean": 0.03091900609433651,
      "rotation_flip": 0.02187499962747097,
      "sparse_tokens": 5344.0,
      "step": 1123,
      "turn_loss": 0.3498658537864685,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.05222077680728489,
      "grad_norm": 0.6740118861198425,
      "learning_rate": 9.825151799922665e-06,
      "loss": 0.1563,
      "mae_dtheta": 0.03288092464208603,
      "mae_dx": 0.011305819265544415,
      "mae_dy": 0.010174623690545559,
      "pose_mae_dtheta": 0.2646768391132355,
      "pose_mae_dx": 0.08869052678346634,
      "pose_mae_dy": 0.09978631883859634,
      "pose_rmse_dtheta": 0.4293183386325836,
      "pose_rmse_dx": 0.20936132967472076,
      "pose_rmse_dy": 0.23894257843494415,
      "pose_rmse_mean": 0.2925407588481903,
      "rmse_dtheta": 0.047647323459386826,
      "rmse_dx": 0.021205246448516846,
      "rmse_dy": 0.02039513736963272,
      "rmse_mean": 0.02974923700094223,
      "rotation_flip": 0.014263074845075607,
      "sparse_tokens": 12525.0,
      "step": 1124,
      "turn_loss": 0.4082373082637787,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.05226723657312767,
      "grad_norm": 0.7744513750076294,
      "learning_rate": 9.824805027150828e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.03072965517640114,
      "mae_dx": 0.012218130752444267,
      "mae_dy": 0.004160584416240454,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.774451732635498,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 137.710693359375,
      "model/head/act_norm_mean": 98.82976645611703,
      "model/head/act_norm_min": 74.05912780761719,
      "model/head/act_over_embed": 67.91674076749487,
      "model/head/grad_frac": 0.0821976289153099,
      "model/head/grad_norm": 0.06365809589624405,
      "model/head/grad_zero_frac": 0.0001764031039783731,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6766331449468085,
      "model/head/update_ratio": 0.0011096118250861764,
      "model/head/weight_delta": 3.7330009937286377,
      "model/head/weight_delta_rel": 0.06548789143562317,
      "model/head/weight_norm": 57.36969757080078,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.411908894777298,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.411868691444397,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4118252992630005,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2830400207360308,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07886005192995071,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06107330322265625,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5316975911458334,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001989631215110421,
      "model/modality_embedder.encoders.pose/weight_delta": 1.1774928569793701,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.038472361862659454,
      "model/modality_embedder.encoders.pose/weight_norm": 30.695791244506836,
      "model/modality_embedder/grad_frac": 0.07886005192995071,
      "model/modality_embedder/grad_norm": 0.06107330322265625,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5316975911458334,
      "model/modality_embedder/update_ratio": 0.001989631215110421,
      "model/modality_embedder/weight_delta": 1.1774928569793701,
      "model/modality_embedder/weight_delta_rel": 0.038472361862659454,
      "model/modality_embedder/weight_norm": 30.695791244506836,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 70.60885620117188,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.27286759118541,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.034039497375488,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.306123130534319,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07296593487262726,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05650859326124191,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020526195876300335,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.6227529644966125,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.022693494334816933,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.52998924255371,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.2121353149414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.214085190813915,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.77560806274414,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.952936676817027,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06809130311012268,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05273342505097389,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018163747154176235,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.7605088949203491,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.026344623416662216,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.03223991394043,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 73.9842300415039,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.93131015704154,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.279388427734375,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.13302975052208,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07434847950935364,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05757930874824524,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019220637623220682,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.7960457801818848,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.026729727163910866,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.95702362060547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.9713134765625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.875221631205672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.252616882324219,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.468903914753625,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10591775178909302,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08202818781137466,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002791191916912794,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.6750409603118896,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.023069696500897408,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.388229370117188,
      "model/normalizer/grad_frac": 0.36929282546043396,
      "model/normalizer/grad_norm": 0.28599947690963745,
      "model/normalizer/grad_zero_frac": 0.00015008078480605036,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0036748030688613653,
      "model/normalizer/weight_delta": 1.4700428247451782,
      "model/normalizer/weight_delta_rel": 0.01893329992890358,
      "model/normalizer/weight_norm": 77.82715606689453,
      "pose_mae_dtheta": 0.23913376033306122,
      "pose_mae_dx": 0.09341646730899811,
      "pose_mae_dy": 0.055016957223415375,
      "pose_rmse_dtheta": 0.46254101395606995,
      "pose_rmse_dx": 0.21608182787895203,
      "pose_rmse_dy": 0.12402328103780746,
      "pose_rmse_mean": 0.26754871010780334,
      "rmse_dtheta": 0.04940151050686836,
      "rmse_dx": 0.02424900233745575,
      "rmse_dy": 0.008719544857740402,
      "rmse_mean": 0.02745668590068817,
      "rotation_flip": 0.01889338716864586,
      "sparse_tokens": 12232.0,
      "step": 1125,
      "turn_loss": 0.22638961672782898,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.05231369633897045,
      "grad_norm": 0.7038574814796448,
      "learning_rate": 9.824457916977785e-06,
      "loss": 0.1462,
      "mae_dtheta": 0.009674527682363987,
      "mae_dx": 0.002212272956967354,
      "mae_dy": 0.002334407065063715,
      "pose_mae_dtheta": 0.07053038477897644,
      "pose_mae_dx": 0.027914470061659813,
      "pose_mae_dy": 0.02896617166697979,
      "pose_rmse_dtheta": 0.1487579494714737,
      "pose_rmse_dx": 0.06600260734558105,
      "pose_rmse_dy": 0.0712515264749527,
      "pose_rmse_mean": 0.09533736109733582,
      "rmse_dtheta": 0.019826853647828102,
      "rmse_dx": 0.006575147621333599,
      "rmse_dy": 0.005063849966973066,
      "rmse_mean": 0.010488617233932018,
      "rotation_flip": 0.00601116381585598,
      "sparse_tokens": 32105.0,
      "step": 1126,
      "turn_loss": 0.09299307316541672,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.05236015610481323,
      "grad_norm": 0.5198016166687012,
      "learning_rate": 9.82411046942781e-06,
      "loss": 0.116,
      "mae_dtheta": 0.03852814808487892,
      "mae_dx": 0.011030811816453934,
      "mae_dy": 0.0027123650070279837,
      "pose_mae_dtheta": 0.35440364480018616,
      "pose_mae_dx": 0.0938505083322525,
      "pose_mae_dy": 0.03240739554166794,
      "pose_rmse_dtheta": 0.5600072145462036,
      "pose_rmse_dx": 0.19433341920375824,
      "pose_rmse_dy": 0.07460829615592957,
      "pose_rmse_mean": 0.2763163447380066,
      "rmse_dtheta": 0.05559242144227028,
      "rmse_dx": 0.021881211549043655,
      "rmse_dy": 0.006039734464138746,
      "rmse_mean": 0.027837788686156273,
      "rotation_flip": 0.01955307275056839,
      "sparse_tokens": 12516.0,
      "step": 1127,
      "turn_loss": 0.29386934638023376,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 27816.0,
      "epoch": 0.05240661587065601,
      "grad_norm": 0.7024893760681152,
      "learning_rate": 9.823762684525202e-06,
      "loss": 0.2068,
      "mae_dtheta": 0.03770148381590843,
      "mae_dx": 0.01618913561105728,
      "mae_dy": 0.008041011169552803,
      "pose_mae_dtheta": 0.3038402497768402,
      "pose_mae_dx": 0.12381724268198013,
      "pose_mae_dy": 0.11133557558059692,
      "pose_rmse_dtheta": 0.473356693983078,
      "pose_rmse_dx": 0.24596217274665833,
      "pose_rmse_dy": 0.22927387058734894,
      "pose_rmse_mean": 0.31619757413864136,
      "rmse_dtheta": 0.05140617489814758,
      "rmse_dx": 0.02938101999461651,
      "rmse_dy": 0.01489846408367157,
      "rmse_mean": 0.031895220279693604,
      "rotation_flip": 0.01744186133146286,
      "sparse_tokens": 23204.0,
      "step": 1128,
      "turn_loss": 0.3408608138561249,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.05245307563649879,
      "grad_norm": 0.6233880519866943,
      "learning_rate": 9.82341456229428e-06,
      "loss": 0.0821,
      "mae_dtheta": 0.026689987629652023,
      "mae_dx": 0.010113823227584362,
      "mae_dy": 0.0026115248911082745,
      "pose_mae_dtheta": 0.2349380999803543,
      "pose_mae_dx": 0.0883072093129158,
      "pose_mae_dy": 0.03536742553114891,
      "pose_rmse_dtheta": 0.5217547416687012,
      "pose_rmse_dx": 0.2481272667646408,
      "pose_rmse_dy": 0.0869390144944191,
      "pose_rmse_mean": 0.2856070399284363,
      "rmse_dtheta": 0.0509646050632,
      "rmse_dx": 0.02458474040031433,
      "rmse_dy": 0.00500883162021637,
      "rmse_mean": 0.026852726936340332,
      "rotation_flip": 0.008928571827709675,
      "sparse_tokens": 5903.0,
      "step": 1129,
      "turn_loss": 0.16138456761837006,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.05249953540234157,
      "grad_norm": 0.6343839764595032,
      "learning_rate": 9.823066102759387e-06,
      "loss": 0.1756,
      "mae_dtheta": 0.03163789212703705,
      "mae_dx": 0.011241823434829712,
      "mae_dy": 0.0035868745762854815,
      "pose_mae_dtheta": 0.2569345235824585,
      "pose_mae_dx": 0.10004371404647827,
      "pose_mae_dy": 0.05422309786081314,
      "pose_rmse_dtheta": 0.49451661109924316,
      "pose_rmse_dx": 0.2505132555961609,
      "pose_rmse_dy": 0.13229593634605408,
      "pose_rmse_mean": 0.2924419343471527,
      "rmse_dtheta": 0.052079468965530396,
      "rmse_dx": 0.02449892833828926,
      "rmse_dy": 0.0064982143230736256,
      "rmse_mean": 0.02769220434129238,
      "rotation_flip": 0.015714285895228386,
      "sparse_tokens": 13287.0,
      "step": 1130,
      "turn_loss": 0.1884329468011856,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.05254599516818435,
      "grad_norm": 0.7189316153526306,
      "learning_rate": 9.822717305944895e-06,
      "loss": 0.1477,
      "mae_dtheta": 0.04074881970882416,
      "mae_dx": 0.017681503668427467,
      "mae_dy": 0.005292549729347229,
      "pose_mae_dtheta": 0.3171941936016083,
      "pose_mae_dx": 0.1488877385854721,
      "pose_mae_dy": 0.070859394967556,
      "pose_rmse_dtheta": 0.530137836933136,
      "pose_rmse_dx": 0.2893388271331787,
      "pose_rmse_dy": 0.15408360958099365,
      "pose_rmse_mean": 0.3245201110839844,
      "rmse_dtheta": 0.05699685961008072,
      "rmse_dx": 0.0300306249409914,
      "rmse_dy": 0.009876256808638573,
      "rmse_mean": 0.032301247119903564,
      "rotation_flip": 0.019999999552965164,
      "sparse_tokens": 8012.0,
      "step": 1131,
      "turn_loss": 0.2897958755493164,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.05259245493402713,
      "grad_norm": 0.467831552028656,
      "learning_rate": 9.822368171875193e-06,
      "loss": 0.1576,
      "mae_dtheta": 0.03576728329062462,
      "mae_dx": 0.01396400947123766,
      "mae_dy": 0.003534171963110566,
      "pose_mae_dtheta": 0.288826048374176,
      "pose_mae_dx": 0.11044221371412277,
      "pose_mae_dy": 0.043353307992219925,
      "pose_rmse_dtheta": 0.4822986125946045,
      "pose_rmse_dx": 0.24404233694076538,
      "pose_rmse_dy": 0.10779467970132828,
      "pose_rmse_mean": 0.2780452370643616,
      "rmse_dtheta": 0.05292409658432007,
      "rmse_dx": 0.02673370949923992,
      "rmse_dy": 0.007052714936435223,
      "rmse_mean": 0.028903506696224213,
      "rotation_flip": 0.0147569440305233,
      "sparse_tokens": 18302.0,
      "step": 1132,
      "turn_loss": 0.2510831654071808,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.052638914699869914,
      "grad_norm": 0.5430634617805481,
      "learning_rate": 9.822018700574696e-06,
      "loss": 0.094,
      "mae_dtheta": 0.009896013885736465,
      "mae_dx": 0.002219193847849965,
      "mae_dy": 0.0021842033602297306,
      "pose_mae_dtheta": 0.07019279152154922,
      "pose_mae_dx": 0.025965703651309013,
      "pose_mae_dy": 0.03433604538440704,
      "pose_rmse_dtheta": 0.1273455023765564,
      "pose_rmse_dx": 0.06907578557729721,
      "pose_rmse_dy": 0.07805077731609344,
      "pose_rmse_mean": 0.09149068593978882,
      "rmse_dtheta": 0.018431706354022026,
      "rmse_dx": 0.007331628352403641,
      "rmse_dy": 0.004216351546347141,
      "rmse_mean": 0.009993229061365128,
      "rotation_flip": 0.005787036847323179,
      "sparse_tokens": 32089.0,
      "step": 1133,
      "turn_loss": 0.09211496263742447,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.05268537446571269,
      "grad_norm": 0.6662679314613342,
      "learning_rate": 9.821668892067843e-06,
      "loss": 0.1569,
      "mae_dtheta": 0.03376804292201996,
      "mae_dx": 0.015569125302135944,
      "mae_dy": 0.004111573100090027,
      "pose_mae_dtheta": 0.26876533031463623,
      "pose_mae_dx": 0.13360324501991272,
      "pose_mae_dy": 0.055141158401966095,
      "pose_rmse_dtheta": 0.478401243686676,
      "pose_rmse_dx": 0.299528032541275,
      "pose_rmse_dy": 0.13062304258346558,
      "pose_rmse_mean": 0.30285078287124634,
      "rmse_dtheta": 0.05236845836043358,
      "rmse_dx": 0.030300257727503777,
      "rmse_dy": 0.008095317520201206,
      "rmse_mean": 0.030254676938056946,
      "rotation_flip": 0.017133956775069237,
      "sparse_tokens": 10236.0,
      "step": 1134,
      "turn_loss": 0.2734370529651642,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.052731834231555474,
      "grad_norm": 0.44495201110839844,
      "learning_rate": 9.821318746379097e-06,
      "loss": 0.1673,
      "mae_dtheta": 0.012486669234931469,
      "mae_dx": 0.0018097199499607086,
      "mae_dy": 0.0026150858029723167,
      "pose_mae_dtheta": 0.08467257767915726,
      "pose_mae_dx": 0.025529904291033745,
      "pose_mae_dy": 0.032557059079408646,
      "pose_rmse_dtheta": 0.17509324848651886,
      "pose_rmse_dx": 0.06366679072380066,
      "pose_rmse_dy": 0.07482555508613586,
      "pose_rmse_mean": 0.1045285314321518,
      "rmse_dtheta": 0.023917529731988907,
      "rmse_dx": 0.004985183011740446,
      "rmse_dy": 0.005365134682506323,
      "rmse_mean": 0.011422615498304367,
      "rotation_flip": 0.006741573102772236,
      "sparse_tokens": 32121.0,
      "step": 1135,
      "turn_loss": 0.11012439429759979,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.05277829399739825,
      "grad_norm": 0.6247216463088989,
      "learning_rate": 9.820968263532942e-06,
      "loss": 0.133,
      "mae_dtheta": 0.013468809425830841,
      "mae_dx": 0.0034126972313970327,
      "mae_dy": 0.0036137145943939686,
      "pose_mae_dtheta": 0.09472464770078659,
      "pose_mae_dx": 0.0363619327545166,
      "pose_mae_dy": 0.0386686772108078,
      "pose_rmse_dtheta": 0.22627973556518555,
      "pose_rmse_dx": 0.10687746107578278,
      "pose_rmse_dy": 0.11671078205108643,
      "pose_rmse_mean": 0.14995598793029785,
      "rmse_dtheta": 0.028577929362654686,
      "rmse_dx": 0.010532370768487453,
      "rmse_dy": 0.010432206094264984,
      "rmse_mean": 0.016514169052243233,
      "rotation_flip": 0.004940014332532883,
      "sparse_tokens": 32137.0,
      "step": 1136,
      "turn_loss": 0.12781664729118347,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.052824753763241035,
      "grad_norm": 0.6422955393791199,
      "learning_rate": 9.820617443553889e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.010974608361721039,
      "mae_dx": 0.0014122596476227045,
      "mae_dy": 0.0019282422726973891,
      "pose_mae_dtheta": 0.08145654946565628,
      "pose_mae_dx": 0.02040664665400982,
      "pose_mae_dy": 0.03294214606285095,
      "pose_rmse_dtheta": 0.19274058938026428,
      "pose_rmse_dx": 0.04665873944759369,
      "pose_rmse_dy": 0.07861480116844177,
      "pose_rmse_mean": 0.10600471496582031,
      "rmse_dtheta": 0.024047885090112686,
      "rmse_dx": 0.004475828725844622,
      "rmse_dy": 0.0037026035133749247,
      "rmse_mean": 0.010742105543613434,
      "rotation_flip": 0.004095003940165043,
      "sparse_tokens": 32057.0,
      "step": 1137,
      "turn_loss": 0.06339526176452637,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15545.0,
      "epoch": 0.05287121352908381,
      "grad_norm": 0.6829950213432312,
      "learning_rate": 9.820266286466472e-06,
      "loss": 0.222,
      "mae_dtheta": 0.046503469347953796,
      "mae_dx": 0.027582939714193344,
      "mae_dy": 0.008865876123309135,
      "pose_mae_dtheta": 0.38198623061180115,
      "pose_mae_dx": 0.23805753886699677,
      "pose_mae_dy": 0.12826955318450928,
      "pose_rmse_dtheta": 0.5601063370704651,
      "pose_rmse_dx": 0.4034390449523926,
      "pose_rmse_dy": 0.2439306527376175,
      "pose_rmse_mean": 0.4024920165538788,
      "rmse_dtheta": 0.06215101107954979,
      "rmse_dx": 0.0409604012966156,
      "rmse_dy": 0.013605042360723019,
      "rmse_mean": 0.03890548646450043,
      "rotation_flip": 0.00935828872025013,
      "sparse_tokens": 12372.0,
      "step": 1138,
      "turn_loss": 0.5492560863494873,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.052917673294926595,
      "grad_norm": 0.9316298961639404,
      "learning_rate": 9.819914792295246e-06,
      "loss": 0.2263,
      "mae_dtheta": 0.03475223109126091,
      "mae_dx": 0.00441616028547287,
      "mae_dy": 0.00435584457591176,
      "pose_mae_dtheta": 0.2766781151294708,
      "pose_mae_dx": 0.032026734203100204,
      "pose_mae_dy": 0.06066448986530304,
      "pose_rmse_dtheta": 0.4953400492668152,
      "pose_rmse_dx": 0.0775601714849472,
      "pose_rmse_dy": 0.13615994155406952,
      "pose_rmse_mean": 0.23635339736938477,
      "rmse_dtheta": 0.0561775304377079,
      "rmse_dx": 0.009839358739554882,
      "rmse_dy": 0.00863600242882967,
      "rmse_mean": 0.02488429844379425,
      "rotation_flip": 0.024024024605751038,
      "sparse_tokens": 5507.0,
      "step": 1139,
      "turn_loss": 0.228607177734375,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05296413306076937,
      "grad_norm": 0.7576326131820679,
      "learning_rate": 9.819562961064791e-06,
      "loss": 0.165,
      "mae_dtheta": 0.016400152817368507,
      "mae_dx": 0.004465707112103701,
      "mae_dy": 0.005185339599847794,
      "pose_mae_dtheta": 0.11358850449323654,
      "pose_mae_dx": 0.05123734101653099,
      "pose_mae_dy": 0.05236944928765297,
      "pose_rmse_dtheta": 0.2557317316532135,
      "pose_rmse_dx": 0.13524805009365082,
      "pose_rmse_dy": 0.12291025370359421,
      "pose_rmse_mean": 0.17129668593406677,
      "rmse_dtheta": 0.031263574957847595,
      "rmse_dx": 0.013097117654979229,
      "rmse_dy": 0.011644132435321808,
      "rmse_mean": 0.018668275326490402,
      "rotation_flip": 0.006058446131646633,
      "sparse_tokens": 32089.0,
      "step": 1140,
      "turn_loss": 0.16416515409946442,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.053010592826612156,
      "grad_norm": 0.43130800127983093,
      "learning_rate": 9.819210792799711e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.019461270421743393,
      "mae_dx": 0.0036075511015951633,
      "mae_dy": 0.005452791228890419,
      "pose_mae_dtheta": 0.14350800216197968,
      "pose_mae_dx": 0.05061868950724602,
      "pose_mae_dy": 0.060697827488183975,
      "pose_rmse_dtheta": 0.2812385857105255,
      "pose_rmse_dx": 0.11350806057453156,
      "pose_rmse_dy": 0.1310858130455017,
      "pose_rmse_mean": 0.1752775013446808,
      "rmse_dtheta": 0.03334946930408478,
      "rmse_dx": 0.008899634703993797,
      "rmse_dy": 0.01031708624213934,
      "rmse_mean": 0.017522064968943596,
      "rotation_flip": 0.007534659467637539,
      "sparse_tokens": 32121.0,
      "step": 1141,
      "turn_loss": 0.1533295065164566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.05305705259245493,
      "grad_norm": 0.6289308667182922,
      "learning_rate": 9.818858287524635e-06,
      "loss": 0.1884,
      "mae_dtheta": 0.03817851096391678,
      "mae_dx": 0.012761714868247509,
      "mae_dy": 0.007041897624731064,
      "pose_mae_dtheta": 0.2719878852367401,
      "pose_mae_dx": 0.1018185168504715,
      "pose_mae_dy": 0.07982297241687775,
      "pose_rmse_dtheta": 0.49780890345573425,
      "pose_rmse_dx": 0.23211181163787842,
      "pose_rmse_dy": 0.18925650417804718,
      "pose_rmse_mean": 0.3063924312591553,
      "rmse_dtheta": 0.056394755840301514,
      "rmse_dx": 0.02525022067129612,
      "rmse_dy": 0.014283338561654091,
      "rmse_mean": 0.03197610378265381,
      "rotation_flip": 0.01879699155688286,
      "sparse_tokens": 15993.0,
      "step": 1142,
      "turn_loss": 0.31756001710891724,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.053103512358297716,
      "grad_norm": 0.8706232905387878,
      "learning_rate": 9.81850544526421e-06,
      "loss": 0.3527,
      "mae_dtheta": 0.03337438404560089,
      "mae_dx": 0.008110295049846172,
      "mae_dy": 0.0055266330018639565,
      "pose_mae_dtheta": 0.23893027007579803,
      "pose_mae_dx": 0.07449307292699814,
      "pose_mae_dy": 0.06673610955476761,
      "pose_rmse_dtheta": 0.4149412512779236,
      "pose_rmse_dx": 0.17397427558898926,
      "pose_rmse_dy": 0.15122270584106445,
      "pose_rmse_mean": 0.24671274423599243,
      "rmse_dtheta": 0.05166877061128616,
      "rmse_dx": 0.019412711262702942,
      "rmse_dy": 0.01001717709004879,
      "rmse_mean": 0.027032887563109398,
      "rotation_flip": 0.013752455823123455,
      "sparse_tokens": 7322.0,
      "step": 1143,
      "turn_loss": 0.2481270134449005,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05314997212414049,
      "grad_norm": 0.7333899736404419,
      "learning_rate": 9.818152266043115e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.012673751451075077,
      "mae_dx": 0.0034083614591509104,
      "mae_dy": 0.004635436460375786,
      "pose_mae_dtheta": 0.09276390820741653,
      "pose_mae_dx": 0.044705476611852646,
      "pose_mae_dy": 0.04803558811545372,
      "pose_rmse_dtheta": 0.20430931448936462,
      "pose_rmse_dx": 0.11814738810062408,
      "pose_rmse_dy": 0.13862396776676178,
      "pose_rmse_mean": 0.1536935567855835,
      "rmse_dtheta": 0.0264555923640728,
      "rmse_dx": 0.008712816052138805,
      "rmse_dy": 0.012093296274542809,
      "rmse_mean": 0.01575390249490738,
      "rotation_flip": 0.008955223485827446,
      "sparse_tokens": 32089.0,
      "step": 1144,
      "turn_loss": 0.12203095108270645,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.05319643188998328,
      "grad_norm": 0.5846141576766968,
      "learning_rate": 9.817798749886048e-06,
      "loss": 0.1269,
      "mae_dtheta": 0.011058341711759567,
      "mae_dx": 0.0023098101373761892,
      "mae_dy": 0.0016292799264192581,
      "pose_mae_dtheta": 0.0788077563047409,
      "pose_mae_dx": 0.023908188566565514,
      "pose_mae_dy": 0.02426840364933014,
      "pose_rmse_dtheta": 0.2189774066209793,
      "pose_rmse_dx": 0.062028661370277405,
      "pose_rmse_dy": 0.07513594627380371,
      "pose_rmse_mean": 0.11871400475502014,
      "rmse_dtheta": 0.026340195909142494,
      "rmse_dx": 0.006971866823732853,
      "rmse_dy": 0.004173849709331989,
      "rmse_mean": 0.012495304457843304,
      "rotation_flip": 0.006790402811020613,
      "sparse_tokens": 32185.0,
      "step": 1145,
      "turn_loss": 0.08511938154697418,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.053242891655826054,
      "grad_norm": 0.44759470224380493,
      "learning_rate": 9.817444896817724e-06,
      "loss": 0.1452,
      "mae_dtheta": 0.010098553262650967,
      "mae_dx": 0.002767557743936777,
      "mae_dy": 0.0025215977802872658,
      "pose_mae_dtheta": 0.07532445341348648,
      "pose_mae_dx": 0.028147228062152863,
      "pose_mae_dy": 0.02829544059932232,
      "pose_rmse_dtheta": 0.1858443021774292,
      "pose_rmse_dx": 0.07815572619438171,
      "pose_rmse_dy": 0.07380924373865128,
      "pose_rmse_mean": 0.1126030907034874,
      "rmse_dtheta": 0.02256498858332634,
      "rmse_dx": 0.008529805578291416,
      "rmse_dy": 0.006484675221145153,
      "rmse_mean": 0.012526489794254303,
      "rotation_flip": 0.002433090005069971,
      "sparse_tokens": 32073.0,
      "step": 1146,
      "turn_loss": 0.08966854214668274,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.05328935142166884,
      "grad_norm": 0.4838336706161499,
      "learning_rate": 9.817090706862895e-06,
      "loss": 0.1649,
      "mae_dtheta": 0.03594064712524414,
      "mae_dx": 0.010103796608746052,
      "mae_dy": 0.007263858802616596,
      "pose_mae_dtheta": 0.31752997636795044,
      "pose_mae_dx": 0.09764514863491058,
      "pose_mae_dy": 0.11463582515716553,
      "pose_rmse_dtheta": 0.5150481462478638,
      "pose_rmse_dx": 0.20556946098804474,
      "pose_rmse_dy": 0.23130935430526733,
      "pose_rmse_mean": 0.3173089921474457,
      "rmse_dtheta": 0.05230548977851868,
      "rmse_dx": 0.021816743537783623,
      "rmse_dy": 0.011932236142456532,
      "rmse_mean": 0.0286848247051239,
      "rotation_flip": 0.015359741635620594,
      "sparse_tokens": 22226.0,
      "step": 1147,
      "turn_loss": 0.293556272983551,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.053335811187511614,
      "grad_norm": 0.5514336824417114,
      "learning_rate": 9.816736180046328e-06,
      "loss": 0.1607,
      "mae_dtheta": 0.01824217103421688,
      "mae_dx": 0.002922861138358712,
      "mae_dy": 0.0032946595456451178,
      "pose_mae_dtheta": 0.14088673889636993,
      "pose_mae_dx": 0.038110218942165375,
      "pose_mae_dy": 0.04196847602725029,
      "pose_rmse_dtheta": 0.3179018497467041,
      "pose_rmse_dx": 0.09515611082315445,
      "pose_rmse_dy": 0.10249261558055878,
      "pose_rmse_mean": 0.17185018956661224,
      "rmse_dtheta": 0.0352376326918602,
      "rmse_dx": 0.00856948085129261,
      "rmse_dy": 0.006820752751082182,
      "rmse_mean": 0.01687595620751381,
      "rotation_flip": 0.00506033468991518,
      "sparse_tokens": 32121.0,
      "step": 1148,
      "turn_loss": 0.1327306032180786,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.0533822709533544,
      "grad_norm": 0.5494155883789062,
      "learning_rate": 9.816381316392814e-06,
      "loss": 0.1762,
      "mae_dtheta": 0.01924017444252968,
      "mae_dx": 0.004505891818553209,
      "mae_dy": 0.006344951223582029,
      "pose_mae_dtheta": 0.13783703744411469,
      "pose_mae_dx": 0.05768957734107971,
      "pose_mae_dy": 0.059842925518751144,
      "pose_rmse_dtheta": 0.25938668847084045,
      "pose_rmse_dx": 0.12714391946792603,
      "pose_rmse_dy": 0.13138028979301453,
      "pose_rmse_mean": 0.1726369708776474,
      "rmse_dtheta": 0.03457708656787872,
      "rmse_dx": 0.010895832441747189,
      "rmse_dy": 0.012107099406421185,
      "rmse_mean": 0.019193340092897415,
      "rotation_flip": 0.004813477862626314,
      "sparse_tokens": 32153.0,
      "step": 1149,
      "turn_loss": 0.20796188712120056,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.053428730719197175,
      "grad_norm": 0.8864264488220215,
      "learning_rate": 9.816026115927169e-06,
      "loss": 0.1756,
      "mae_dtheta": 0.040149588137865067,
      "mae_dx": 0.012262838892638683,
      "mae_dy": 0.00795862264931202,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8864264488220215,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 137.4564971923828,
      "model/head/act_norm_mean": 100.98855633802818,
      "model/head/act_norm_min": 76.69209289550781,
      "model/head/act_over_embed": 69.40028138525352,
      "model/head/grad_frac": 0.09875146299600601,
      "model/head/grad_norm": 0.08753591030836105,
      "model/head/grad_zero_frac": 8.12215730547905e-05,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6852030149647887,
      "model/head/update_ratio": 0.0015255787875503302,
      "model/head/weight_delta": 3.778768301010132,
      "model/head/weight_delta_rel": 0.06629078835248947,
      "model/head/weight_norm": 57.37881851196289,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4119163155555725,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4119163155555725,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4119163155555725,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2830727484710946,
      "model/modality_embedder.encoders.pose/grad_frac": 0.13993842899799347,
      "model/modality_embedder.encoders.pose/grad_norm": 0.12404512614011765,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.004040855448693037,
      "model/modality_embedder.encoders.pose/weight_delta": 1.198746919631958,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.03916679695248604,
      "model/modality_embedder.encoders.pose/weight_norm": 30.69774055480957,
      "model/modality_embedder/grad_frac": 0.13993842899799347,
      "model/modality_embedder/grad_norm": 0.12404512614011765,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.004040855448693037,
      "model/modality_embedder/weight_delta": 1.198746919631958,
      "model/modality_embedder/weight_delta_rel": 0.03916679695248604,
      "model/modality_embedder/weight_norm": 30.69774055480957,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.70278930664062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.50219022468142,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.949209213256836,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.463715791225097,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09707625210285187,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.08605095744132996,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 8.069722389336675e-05,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0031255711801350117,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.6341067552566528,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.02310723252594471,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.531274795532227,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.16807556152344,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.371250069863628,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.641369819641113,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.06094185310077,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10317152738571167,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.09145396947860718,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 9.582795610185713e-05,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0031497033778578043,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.7760511040687561,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.026883017271757126,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.03573989868164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.94319915771484,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.045081251397274,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.180941581726074,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.21121431170511,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11267098784446716,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.09987454116344452,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 8.574080129619688e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.003333533415570855,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.8124956488609314,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.02728208340704441,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.96056365966797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.47423553466797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.057693382517325,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.139107704162598,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.594300210582446,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.14069418609142303,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.12471505254507065,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 7.565364649053663e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.004243331495672464,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.6899866461753845,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.02358046919107437,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.39083480834961,
      "model/normalizer/grad_frac": 0.5659439563751221,
      "model/normalizer/grad_norm": 0.5016676783561707,
      "model/normalizer/grad_zero_frac": 8.626690396340564e-05,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.006445606704801321,
      "model/normalizer/weight_delta": 1.5002131462097168,
      "model/normalizer/weight_delta_rel": 0.019321877509355545,
      "model/normalizer/weight_norm": 77.83094787597656,
      "pose_mae_dtheta": 0.3528796434402466,
      "pose_mae_dx": 0.09608260542154312,
      "pose_mae_dy": 0.09300237149000168,
      "pose_rmse_dtheta": 0.5836334824562073,
      "pose_rmse_dx": 0.19355998933315277,
      "pose_rmse_dy": 0.21518521010875702,
      "pose_rmse_mean": 0.3307929039001465,
      "rmse_dtheta": 0.0586346797645092,
      "rmse_dx": 0.02340228110551834,
      "rmse_dy": 0.01559353992342949,
      "rmse_mean": 0.03254350274801254,
      "rotation_flip": 0.015594542026519775,
      "sparse_tokens": 17796.0,
      "step": 1150,
      "turn_loss": 0.3069823384284973,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05347519048503996,
      "grad_norm": 0.4231078028678894,
      "learning_rate": 9.815670578674232e-06,
      "loss": 0.0689,
      "mae_dtheta": 0.007855348289012909,
      "mae_dx": 0.0016760617727413774,
      "mae_dy": 0.000718052324373275,
      "pose_mae_dtheta": 0.059915781021118164,
      "pose_mae_dx": 0.015203270129859447,
      "pose_mae_dy": 0.012521249242126942,
      "pose_rmse_dtheta": 0.220550075173378,
      "pose_rmse_dx": 0.054314520210027695,
      "pose_rmse_dy": 0.03093043901026249,
      "pose_rmse_mean": 0.10193167626857758,
      "rmse_dtheta": 0.025243202224373817,
      "rmse_dx": 0.006029079202562571,
      "rmse_dy": 0.0014026474673300982,
      "rmse_mean": 0.010891642421483994,
      "rotation_flip": 0.0037678976077586412,
      "sparse_tokens": 32089.0,
      "step": 1151,
      "turn_loss": 0.04541454091668129,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.053521650250882735,
      "grad_norm": 0.6614478826522827,
      "learning_rate": 9.81531470465887e-06,
      "loss": 0.1333,
      "mae_dtheta": 0.030438197776675224,
      "mae_dx": 0.012335172854363918,
      "mae_dy": 0.004435820505023003,
      "pose_mae_dtheta": 0.20704664289951324,
      "pose_mae_dx": 0.09706258773803711,
      "pose_mae_dy": 0.04860948026180267,
      "pose_rmse_dtheta": 0.3152768611907959,
      "pose_rmse_dx": 0.19723139703273773,
      "pose_rmse_dy": 0.10879868268966675,
      "pose_rmse_mean": 0.20710232853889465,
      "rmse_dtheta": 0.04283112660050392,
      "rmse_dx": 0.022194504737854004,
      "rmse_dy": 0.008680019527673721,
      "rmse_mean": 0.024568548426032066,
      "rotation_flip": 0.024054983630776405,
      "sparse_tokens": 4925.0,
      "step": 1152,
      "turn_loss": 0.3010670244693756,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.05356811001672552,
      "grad_norm": 0.6287893056869507,
      "learning_rate": 9.814958493905962e-06,
      "loss": 0.1231,
      "mae_dtheta": 0.014761566184461117,
      "mae_dx": 0.002451434498652816,
      "mae_dy": 0.003828848712146282,
      "pose_mae_dtheta": 0.0950775071978569,
      "pose_mae_dx": 0.03166300430893898,
      "pose_mae_dy": 0.04769907519221306,
      "pose_rmse_dtheta": 0.20517726242542267,
      "pose_rmse_dx": 0.09316146373748779,
      "pose_rmse_dy": 0.13695095479488373,
      "pose_rmse_mean": 0.1450965702533722,
      "rmse_dtheta": 0.027551395818591118,
      "rmse_dx": 0.008385628461837769,
      "rmse_dy": 0.010218054987490177,
      "rmse_mean": 0.015385027043521404,
      "rotation_flip": 0.008348457515239716,
      "sparse_tokens": 32057.0,
      "step": 1153,
      "turn_loss": 0.12982487678527832,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.053614569782568296,
      "grad_norm": 0.43076756596565247,
      "learning_rate": 9.814601946440426e-06,
      "loss": 0.117,
      "mae_dtheta": 0.04335261881351471,
      "mae_dx": 0.014061781577765942,
      "mae_dy": 0.009037678129971027,
      "pose_mae_dtheta": 0.36957648396492004,
      "pose_mae_dx": 0.11331002414226532,
      "pose_mae_dy": 0.11153236776590347,
      "pose_rmse_dtheta": 0.613370954990387,
      "pose_rmse_dx": 0.22167547047138214,
      "pose_rmse_dy": 0.2196350395679474,
      "pose_rmse_mean": 0.35156047344207764,
      "rmse_dtheta": 0.0602731816470623,
      "rmse_dx": 0.025829147547483444,
      "rmse_dy": 0.015018803998827934,
      "rmse_mean": 0.03370704501867294,
      "rotation_flip": 0.02181818149983883,
      "sparse_tokens": 13563.0,
      "step": 1154,
      "turn_loss": 0.35545796155929565,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.05366102954841108,
      "grad_norm": 0.6526503562927246,
      "learning_rate": 9.81424506228719e-06,
      "loss": 0.1147,
      "mae_dtheta": 0.038905225694179535,
      "mae_dx": 0.01403303723782301,
      "mae_dy": 0.007095848210155964,
      "pose_mae_dtheta": 0.3102126121520996,
      "pose_mae_dx": 0.10411835461854935,
      "pose_mae_dy": 0.10061049461364746,
      "pose_rmse_dtheta": 0.5274345874786377,
      "pose_rmse_dx": 0.22878490388393402,
      "pose_rmse_dy": 0.19463954865932465,
      "pose_rmse_mean": 0.31695303320884705,
      "rmse_dtheta": 0.056659597903490067,
      "rmse_dx": 0.02793833799660206,
      "rmse_dy": 0.01325182057917118,
      "rmse_mean": 0.03261658549308777,
      "rotation_flip": 0.013977128081023693,
      "sparse_tokens": 16781.0,
      "step": 1155,
      "turn_loss": 0.34588974714279175,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.053707489314253856,
      "grad_norm": 0.36709579825401306,
      "learning_rate": 9.81388784147121e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.010093346238136292,
      "mae_dx": 0.0026729158125817776,
      "mae_dy": 0.003102183109149337,
      "pose_mae_dtheta": 0.06978455930948257,
      "pose_mae_dx": 0.03813905268907547,
      "pose_mae_dy": 0.03180105984210968,
      "pose_rmse_dtheta": 0.14119939506053925,
      "pose_rmse_dx": 0.087032251060009,
      "pose_rmse_dy": 0.07034863531589508,
      "pose_rmse_mean": 0.09952676296234131,
      "rmse_dtheta": 0.02038998156785965,
      "rmse_dx": 0.006488512270152569,
      "rmse_dy": 0.006963735446333885,
      "rmse_mean": 0.011280743405222893,
      "rotation_flip": 0.004369992762804031,
      "sparse_tokens": 32137.0,
      "step": 1156,
      "turn_loss": 0.09549552947282791,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.05375394908009663,
      "grad_norm": 0.4598918557167053,
      "learning_rate": 9.813530284017475e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.013071108609437943,
      "mae_dx": 0.0026761810295283794,
      "mae_dy": 0.003688817610964179,
      "pose_mae_dtheta": 0.08597175031900406,
      "pose_mae_dx": 0.03521556034684181,
      "pose_mae_dy": 0.0369812436401844,
      "pose_rmse_dtheta": 0.1651613861322403,
      "pose_rmse_dx": 0.08068098872900009,
      "pose_rmse_dy": 0.08724206686019897,
      "pose_rmse_mean": 0.11102814972400665,
      "rmse_dtheta": 0.02379736490547657,
      "rmse_dx": 0.0068269940093159676,
      "rmse_dy": 0.0077949874103069305,
      "rmse_mean": 0.012806449085474014,
      "rotation_flip": 0.0062952470034360886,
      "sparse_tokens": 32169.0,
      "step": 1157,
      "turn_loss": 0.13242760300636292,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05380040884593942,
      "grad_norm": 0.5847267508506775,
      "learning_rate": 9.81317238995098e-06,
      "loss": 0.1714,
      "mae_dtheta": 0.017195239663124084,
      "mae_dx": 0.004066812805831432,
      "mae_dy": 0.003619717201218009,
      "pose_mae_dtheta": 0.11773277819156647,
      "pose_mae_dx": 0.04088137298822403,
      "pose_mae_dy": 0.041031934320926666,
      "pose_rmse_dtheta": 0.25694870948791504,
      "pose_rmse_dx": 0.10747609287500381,
      "pose_rmse_dy": 0.08687566220760345,
      "pose_rmse_mean": 0.1504334807395935,
      "rmse_dtheta": 0.03229136765003204,
      "rmse_dx": 0.011869519017636776,
      "rmse_dy": 0.0077080074697732925,
      "rmse_mean": 0.017289631068706512,
      "rotation_flip": 0.003321033203974366,
      "sparse_tokens": 32089.0,
      "step": 1158,
      "turn_loss": 0.14691153168678284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.053846868611782193,
      "grad_norm": 0.48588883876800537,
      "learning_rate": 9.812814159296757e-06,
      "loss": 0.0871,
      "mae_dtheta": 0.006489201914519072,
      "mae_dx": 0.00213072681799531,
      "mae_dy": 0.0003829824272543192,
      "pose_mae_dtheta": 0.05137735605239868,
      "pose_mae_dx": 0.01915491186082363,
      "pose_mae_dy": 0.006565496791154146,
      "pose_rmse_dtheta": 0.2289498895406723,
      "pose_rmse_dx": 0.05331669747829437,
      "pose_rmse_dy": 0.0187614094465971,
      "pose_rmse_mean": 0.10034266114234924,
      "rmse_dtheta": 0.02539859339594841,
      "rmse_dx": 0.006705643143504858,
      "rmse_dy": 0.0010632425546646118,
      "rmse_mean": 0.01105582620948553,
      "rotation_flip": 0.0017286085058003664,
      "sparse_tokens": 32137.0,
      "step": 1159,
      "turn_loss": 0.04565335437655449,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.05389332837762498,
      "grad_norm": 0.9623277187347412,
      "learning_rate": 9.812455592079857e-06,
      "loss": 0.1561,
      "mae_dtheta": 0.03472442924976349,
      "mae_dx": 0.01473111193627119,
      "mae_dy": 0.01090798806399107,
      "pose_mae_dtheta": 0.2928357422351837,
      "pose_mae_dx": 0.1375463604927063,
      "pose_mae_dy": 0.15806172788143158,
      "pose_rmse_dtheta": 0.4469758868217468,
      "pose_rmse_dx": 0.27350345253944397,
      "pose_rmse_dy": 0.28045621514320374,
      "pose_rmse_mean": 0.33364519476890564,
      "rmse_dtheta": 0.048911646008491516,
      "rmse_dx": 0.028029846027493477,
      "rmse_dy": 0.01840146631002426,
      "rmse_mean": 0.03178098797798157,
      "rotation_flip": 0.016703786328434944,
      "sparse_tokens": 16274.0,
      "step": 1160,
      "turn_loss": 0.378032386302948,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.053939788143467754,
      "grad_norm": 0.6159775853157043,
      "learning_rate": 9.812096688325354e-06,
      "loss": 0.1204,
      "mae_dtheta": 0.012167626991868019,
      "mae_dx": 0.002633725991472602,
      "mae_dy": 0.0035673498641699553,
      "pose_mae_dtheta": 0.08270642161369324,
      "pose_mae_dx": 0.03316997364163399,
      "pose_mae_dy": 0.03716428577899933,
      "pose_rmse_dtheta": 0.1855894774198532,
      "pose_rmse_dx": 0.0994298905134201,
      "pose_rmse_dy": 0.08845463395118713,
      "pose_rmse_mean": 0.12449133396148682,
      "rmse_dtheta": 0.023722806945443153,
      "rmse_dx": 0.007445653434842825,
      "rmse_dy": 0.008881861343979836,
      "rmse_mean": 0.01335010677576065,
      "rotation_flip": 0.0030698387417942286,
      "sparse_tokens": 32105.0,
      "step": 1161,
      "turn_loss": 0.11141504347324371,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05398624790931054,
      "grad_norm": 0.6787444949150085,
      "learning_rate": 9.811737448058348e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.011683831922709942,
      "mae_dx": 0.0022961152717471123,
      "mae_dy": 0.003053501481190324,
      "pose_mae_dtheta": 0.07961764931678772,
      "pose_mae_dx": 0.03474731743335724,
      "pose_mae_dy": 0.03651771694421768,
      "pose_rmse_dtheta": 0.15941274166107178,
      "pose_rmse_dx": 0.07982692867517471,
      "pose_rmse_dy": 0.07997022569179535,
      "pose_rmse_mean": 0.10640329122543335,
      "rmse_dtheta": 0.02173641324043274,
      "rmse_dx": 0.006168627180159092,
      "rmse_dy": 0.006167047657072544,
      "rmse_mean": 0.011357362382113934,
      "rotation_flip": 0.005011565051972866,
      "sparse_tokens": 32089.0,
      "step": 1162,
      "turn_loss": 0.10415633022785187,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.054032707675153314,
      "grad_norm": 0.9234995245933533,
      "learning_rate": 9.811377871303957e-06,
      "loss": 0.253,
      "mae_dtheta": 0.03831668198108673,
      "mae_dx": 0.014731778763234615,
      "mae_dy": 0.0062006209045648575,
      "pose_mae_dtheta": 0.364803284406662,
      "pose_mae_dx": 0.13642698526382446,
      "pose_mae_dy": 0.0636148527264595,
      "pose_rmse_dtheta": 0.5612021684646606,
      "pose_rmse_dx": 0.2814461588859558,
      "pose_rmse_dy": 0.1316959708929062,
      "pose_rmse_mean": 0.3247814476490021,
      "rmse_dtheta": 0.053841374814510345,
      "rmse_dx": 0.028604643419384956,
      "rmse_dy": 0.01137905940413475,
      "rmse_mean": 0.03127502650022507,
      "rotation_flip": 0.015558699145913124,
      "sparse_tokens": 12334.0,
      "step": 1163,
      "turn_loss": 0.31039959192276,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0540791674409961,
      "grad_norm": 0.7086304426193237,
      "learning_rate": 9.811017958087332e-06,
      "loss": 0.1433,
      "mae_dtheta": 0.005618100520223379,
      "mae_dx": 0.0015794802457094193,
      "mae_dy": 0.000622226856648922,
      "pose_mae_dtheta": 0.04478946700692177,
      "pose_mae_dx": 0.015811162069439888,
      "pose_mae_dy": 0.009761118330061436,
      "pose_rmse_dtheta": 0.17744815349578857,
      "pose_rmse_dx": 0.04775065928697586,
      "pose_rmse_dy": 0.02734421193599701,
      "pose_rmse_mean": 0.08418101072311401,
      "rmse_dtheta": 0.019008759409189224,
      "rmse_dx": 0.005565873812884092,
      "rmse_dy": 0.0015032715164124966,
      "rmse_mean": 0.008692635223269463,
      "rotation_flip": 0.0011990407947450876,
      "sparse_tokens": 32121.0,
      "step": 1164,
      "turn_loss": 0.04529477283358574,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.054125627206838875,
      "grad_norm": 0.46208199858665466,
      "learning_rate": 9.810657708433637e-06,
      "loss": 0.1092,
      "mae_dtheta": 0.01334438007324934,
      "mae_dx": 0.00395742105320096,
      "mae_dy": 0.0032989748287945986,
      "pose_mae_dtheta": 0.10024215281009674,
      "pose_mae_dx": 0.03985554352402687,
      "pose_mae_dy": 0.03400165215134621,
      "pose_rmse_dtheta": 0.2690455913543701,
      "pose_rmse_dx": 0.11314389109611511,
      "pose_rmse_dy": 0.08920876681804657,
      "pose_rmse_mean": 0.15713274478912354,
      "rmse_dtheta": 0.031268712133169174,
      "rmse_dx": 0.0109444260597229,
      "rmse_dy": 0.008758063428103924,
      "rmse_mean": 0.016990400850772858,
      "rotation_flip": 0.0020781380590051413,
      "sparse_tokens": 32121.0,
      "step": 1165,
      "turn_loss": 0.1330905258655548,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.05417208697268166,
      "grad_norm": 0.5718679428100586,
      "learning_rate": 9.810297122368067e-06,
      "loss": 0.1524,
      "mae_dtheta": 0.04027006775140762,
      "mae_dx": 0.013554457575082779,
      "mae_dy": 0.002679570112377405,
      "pose_mae_dtheta": 0.34800034761428833,
      "pose_mae_dx": 0.11205586045980453,
      "pose_mae_dy": 0.020373791456222534,
      "pose_rmse_dtheta": 0.5662150979042053,
      "pose_rmse_dx": 0.23715946078300476,
      "pose_rmse_dy": 0.045679811388254166,
      "pose_rmse_mean": 0.2830181121826172,
      "rmse_dtheta": 0.057482484728097916,
      "rmse_dx": 0.025246061384677887,
      "rmse_dy": 0.005975836422294378,
      "rmse_mean": 0.029568128287792206,
      "rotation_flip": 0.011848341673612595,
      "sparse_tokens": 7965.0,
      "step": 1166,
      "turn_loss": 0.3234120011329651,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.054218546738524435,
      "grad_norm": 0.5150131583213806,
      "learning_rate": 9.809936199915838e-06,
      "loss": 0.0956,
      "mae_dtheta": 0.012015958316624165,
      "mae_dx": 0.002020190004259348,
      "mae_dy": 0.002387094544246793,
      "pose_mae_dtheta": 0.08495325595140457,
      "pose_mae_dx": 0.0253541711717844,
      "pose_mae_dy": 0.031778186559677124,
      "pose_rmse_dtheta": 0.19664223492145538,
      "pose_rmse_dx": 0.05673213303089142,
      "pose_rmse_dy": 0.06921716034412384,
      "pose_rmse_mean": 0.10753051936626434,
      "rmse_dtheta": 0.025671882554888725,
      "rmse_dx": 0.0057096341624855995,
      "rmse_dy": 0.004520014859735966,
      "rmse_mean": 0.011967177502810955,
      "rotation_flip": 0.0030710173305124044,
      "sparse_tokens": 32121.0,
      "step": 1167,
      "turn_loss": 0.08407396078109741,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.05426500650436722,
      "grad_norm": 0.5239246487617493,
      "learning_rate": 9.809574941102187e-06,
      "loss": 0.134,
      "mae_dtheta": 0.013025251217186451,
      "mae_dx": 0.0019511369755491614,
      "mae_dy": 0.003841953817754984,
      "pose_mae_dtheta": 0.09474200755357742,
      "pose_mae_dx": 0.02983744628727436,
      "pose_mae_dy": 0.04277084767818451,
      "pose_rmse_dtheta": 0.23537105321884155,
      "pose_rmse_dx": 0.08091031014919281,
      "pose_rmse_dy": 0.09393434226512909,
      "pose_rmse_mean": 0.136738583445549,
      "rmse_dtheta": 0.02736043557524681,
      "rmse_dx": 0.005377831403166056,
      "rmse_dy": 0.008315682411193848,
      "rmse_mean": 0.013684650883078575,
      "rotation_flip": 0.005957446992397308,
      "sparse_tokens": 32073.0,
      "step": 1168,
      "turn_loss": 0.10697467625141144,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.054311466270209996,
      "grad_norm": 0.4510343074798584,
      "learning_rate": 9.80921334595238e-06,
      "loss": 0.1215,
      "mae_dtheta": 0.012744611129164696,
      "mae_dx": 0.0027099575381726027,
      "mae_dy": 0.003110933117568493,
      "pose_mae_dtheta": 0.08791103214025497,
      "pose_mae_dx": 0.04077884182333946,
      "pose_mae_dy": 0.039742227643728256,
      "pose_rmse_dtheta": 0.19053804874420166,
      "pose_rmse_dx": 0.10568658262491226,
      "pose_rmse_dy": 0.09867057204246521,
      "pose_rmse_mean": 0.1316317319869995,
      "rmse_dtheta": 0.02625865302979946,
      "rmse_dx": 0.008056411519646645,
      "rmse_dy": 0.007261725142598152,
      "rmse_mean": 0.01385892927646637,
      "rotation_flip": 0.008962264284491539,
      "sparse_tokens": 32057.0,
      "step": 1169,
      "turn_loss": 0.10467635095119476,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.05435792603605278,
      "grad_norm": 0.4608488976955414,
      "learning_rate": 9.808851414491703e-06,
      "loss": 0.1492,
      "mae_dtheta": 0.040990062057971954,
      "mae_dx": 0.01366632804274559,
      "mae_dy": 0.004543009679764509,
      "pose_mae_dtheta": 0.3469305634498596,
      "pose_mae_dx": 0.10288011282682419,
      "pose_mae_dy": 0.062013473361730576,
      "pose_rmse_dtheta": 0.5699590444564819,
      "pose_rmse_dx": 0.21431612968444824,
      "pose_rmse_dy": 0.12350895255804062,
      "pose_rmse_mean": 0.30259472131729126,
      "rmse_dtheta": 0.057474326342344284,
      "rmse_dx": 0.02491152100265026,
      "rmse_dy": 0.007487311959266663,
      "rmse_mean": 0.029957719147205353,
      "rotation_flip": 0.004545454401522875,
      "sparse_tokens": 7798.0,
      "step": 1170,
      "turn_loss": 0.20915116369724274,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 35688.0,
      "epoch": 0.054404385801895556,
      "grad_norm": 0.5209535360336304,
      "learning_rate": 9.808489146745466e-06,
      "loss": 0.1467,
      "mae_dtheta": 0.03630761057138443,
      "mae_dx": 0.015196653082966805,
      "mae_dy": 0.00486154155805707,
      "pose_mae_dtheta": 0.29932940006256104,
      "pose_mae_dx": 0.11507608741521835,
      "pose_mae_dy": 0.06194865703582764,
      "pose_rmse_dtheta": 0.5200712084770203,
      "pose_rmse_dx": 0.251811146736145,
      "pose_rmse_dy": 0.16339997947216034,
      "pose_rmse_mean": 0.3117607831954956,
      "rmse_dtheta": 0.05412646383047104,
      "rmse_dx": 0.028521621599793434,
      "rmse_dy": 0.011198828928172588,
      "rmse_mean": 0.03128230571746826,
      "rotation_flip": 0.01471489854156971,
      "sparse_tokens": 27137.0,
      "step": 1171,
      "turn_loss": 0.29527342319488525,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.05445084556773834,
      "grad_norm": 0.6804137825965881,
      "learning_rate": 9.808126542739e-06,
      "loss": 0.1317,
      "mae_dtheta": 0.015694361180067062,
      "mae_dx": 0.003630656749010086,
      "mae_dy": 0.004963097628206015,
      "pose_mae_dtheta": 0.11471792310476303,
      "pose_mae_dx": 0.043915871530771255,
      "pose_mae_dy": 0.05884212255477905,
      "pose_rmse_dtheta": 0.2601810097694397,
      "pose_rmse_dx": 0.11301693320274353,
      "pose_rmse_dy": 0.18807697296142578,
      "pose_rmse_mean": 0.1870916336774826,
      "rmse_dtheta": 0.030581098049879074,
      "rmse_dx": 0.009997524321079254,
      "rmse_dy": 0.014188550412654877,
      "rmse_mean": 0.018255725502967834,
      "rotation_flip": 0.008501593954861164,
      "sparse_tokens": 32121.0,
      "step": 1172,
      "turn_loss": 0.15081460773944855,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.05449730533358112,
      "grad_norm": 0.6895034313201904,
      "learning_rate": 9.807763602497666e-06,
      "loss": 0.1427,
      "mae_dtheta": 0.027403222396969795,
      "mae_dx": 0.0032876895274966955,
      "mae_dy": 0.0028722411952912807,
      "pose_mae_dtheta": 0.23408915102481842,
      "pose_mae_dx": 0.018237512558698654,
      "pose_mae_dy": 0.02902805246412754,
      "pose_rmse_dtheta": 0.5675204396247864,
      "pose_rmse_dx": 0.04846299812197685,
      "pose_rmse_dy": 0.05407329648733139,
      "pose_rmse_mean": 0.22335223853588104,
      "rmse_dtheta": 0.05216330662369728,
      "rmse_dx": 0.009923882782459259,
      "rmse_dy": 0.0046204132959246635,
      "rmse_mean": 0.022235868498682976,
      "rotation_flip": 0.005917159840464592,
      "sparse_tokens": 2965.0,
      "step": 1173,
      "turn_loss": 0.1383894681930542,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.0545437650994239,
      "grad_norm": 0.7069376707077026,
      "learning_rate": 9.807400326046843e-06,
      "loss": 0.1688,
      "mae_dtheta": 0.033635541796684265,
      "mae_dx": 0.008426654152572155,
      "mae_dy": 0.004499675706028938,
      "pose_mae_dtheta": 0.27812036871910095,
      "pose_mae_dx": 0.06536441296339035,
      "pose_mae_dy": 0.04281330108642578,
      "pose_rmse_dtheta": 0.4748755991458893,
      "pose_rmse_dx": 0.15015703439712524,
      "pose_rmse_dy": 0.1098363846540451,
      "pose_rmse_mean": 0.2449563592672348,
      "rmse_dtheta": 0.05098845809698105,
      "rmse_dx": 0.01865595392882824,
      "rmse_dy": 0.009370842017233372,
      "rmse_mean": 0.026338418945670128,
      "rotation_flip": 0.014388489536941051,
      "sparse_tokens": 11034.0,
      "step": 1174,
      "turn_loss": 0.2513682246208191,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.05459022486526668,
      "grad_norm": 0.4585208296775818,
      "learning_rate": 9.807036713411934e-06,
      "loss": 0.158,
      "mae_dtheta": 0.03149823471903801,
      "mae_dx": 0.01159291435033083,
      "mae_dy": 0.004795984365046024,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4585208594799042,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 120.34561157226562,
      "model/head/act_norm_mean": 98.9410520067402,
      "model/head/act_norm_min": 74.85712432861328,
      "model/head/act_over_embed": 67.99321723975486,
      "model/head/grad_frac": 0.11698678135871887,
      "model/head/grad_norm": 0.053640879690647125,
      "model/head/grad_zero_frac": 0.00020749573013745248,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6805300245098039,
      "model/head/update_ratio": 0.0009347182349301875,
      "model/head/weight_delta": 3.820871114730835,
      "model/head/weight_delta_rel": 0.06702939420938492,
      "model/head/weight_norm": 57.3872184753418,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41212087869644165,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41212087869644165,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41212087869644165,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2832133261766501,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0743798315525055,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03410470485687256,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011108802864328027,
      "model/modality_embedder.encoders.pose/weight_delta": 1.2082781791687012,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.03947821259498596,
      "model/modality_embedder.encoders.pose/weight_norm": 30.700611114501953,
      "model/modality_embedder/grad_frac": 0.0743798315525055,
      "model/modality_embedder/grad_norm": 0.03410470485687256,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0011108802864328027,
      "model/modality_embedder/weight_delta": 1.2082781791687012,
      "model/modality_embedder/weight_delta_rel": 0.03947821259498596,
      "model/modality_embedder/weight_norm": 30.700611114501953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 64.17572784423828,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.28625408496732,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.095544815063477,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.315322454387577,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1090531274676323,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.050003133714199066,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018161433981731534,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.6443399786949158,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.023480137810111046,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.532590866088867,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 65.67033386230469,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.244633617335822,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.744848251342773,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.973929841521757,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.11178175359964371,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0512542650103569,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017649956280365586,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.7892401218414307,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.027339894324541092,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.039316177368164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 67.35740661621094,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.995786161686897,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.930466651916504,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.177338264548236,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11055443435907364,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05069151520729065,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016917483881115913,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.8266481757164001,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.027757298201322556,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.963979721069336,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 68.04811096191406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.988241129785248,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.120209693908691,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.546571972282727,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12522868812084198,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05741996690630913,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019535254687070847,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.7023499011993408,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.024002986028790474,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.392995834350586,
      "model/normalizer/grad_frac": 0.48513567447662354,
      "model/normalizer/grad_norm": 0.2224448323249817,
      "model/normalizer/grad_zero_frac": 0.00017135207599494606,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0028579216450452805,
      "model/normalizer/weight_delta": 1.5259044170379639,
      "model/normalizer/weight_delta_rel": 0.01965276524424553,
      "model/normalizer/weight_norm": 77.83447265625,
      "pose_mae_dtheta": 0.25432395935058594,
      "pose_mae_dx": 0.09222394973039627,
      "pose_mae_dy": 0.05502999201416969,
      "pose_rmse_dtheta": 0.4631122052669525,
      "pose_rmse_dx": 0.21550142765045166,
      "pose_rmse_dy": 0.16467981040477753,
      "pose_rmse_mean": 0.2810978293418884,
      "rmse_dtheta": 0.04982611909508705,
      "rmse_dx": 0.023958439007401466,
      "rmse_dy": 0.011363334953784943,
      "rmse_mean": 0.02838263288140297,
      "rotation_flip": 0.007843137718737125,
      "sparse_tokens": 12650.0,
      "step": 1175,
      "turn_loss": 0.26667746901512146,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.05463668463110946,
      "grad_norm": 0.47462892532348633,
      "learning_rate": 9.806672764618368e-06,
      "loss": 0.1055,
      "mae_dtheta": 0.012586496770381927,
      "mae_dx": 0.0023724534548819065,
      "mae_dy": 0.003390464698895812,
      "pose_mae_dtheta": 0.08516691625118256,
      "pose_mae_dx": 0.032925158739089966,
      "pose_mae_dy": 0.04312264174222946,
      "pose_rmse_dtheta": 0.1596948206424713,
      "pose_rmse_dx": 0.0737026110291481,
      "pose_rmse_dy": 0.09592412412166595,
      "pose_rmse_mean": 0.10977385938167572,
      "rmse_dtheta": 0.022058352828025818,
      "rmse_dx": 0.007000992074608803,
      "rmse_dy": 0.006375436671078205,
      "rmse_mean": 0.011811594478785992,
      "rotation_flip": 0.006030150689184666,
      "sparse_tokens": 32105.0,
      "step": 1176,
      "turn_loss": 0.11118636280298233,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.05468314439695224,
      "grad_norm": 0.49665895104408264,
      "learning_rate": 9.806308479691595e-06,
      "loss": 0.1161,
      "mae_dtheta": 0.00967031717300415,
      "mae_dx": 0.0014748016837984324,
      "mae_dy": 0.001581768854521215,
      "pose_mae_dtheta": 0.06459717452526093,
      "pose_mae_dx": 0.019613701850175858,
      "pose_mae_dy": 0.02521553449332714,
      "pose_rmse_dtheta": 0.13988080620765686,
      "pose_rmse_dx": 0.060864098370075226,
      "pose_rmse_dy": 0.0585746094584465,
      "pose_rmse_mean": 0.0864398404955864,
      "rmse_dtheta": 0.021039115265011787,
      "rmse_dx": 0.005766958463937044,
      "rmse_dy": 0.003046870231628418,
      "rmse_mean": 0.009950981475412846,
      "rotation_flip": 0.004692832939326763,
      "sparse_tokens": 32041.0,
      "step": 1177,
      "turn_loss": 0.06966754049062729,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.05472960416279502,
      "grad_norm": 0.6147291660308838,
      "learning_rate": 9.805943858657092e-06,
      "loss": 0.192,
      "mae_dtheta": 0.029762770980596542,
      "mae_dx": 0.014101464301347733,
      "mae_dy": 0.003341768868267536,
      "pose_mae_dtheta": 0.22157567739486694,
      "pose_mae_dx": 0.10959918051958084,
      "pose_mae_dy": 0.03315593674778938,
      "pose_rmse_dtheta": 0.35228943824768066,
      "pose_rmse_dx": 0.2500882148742676,
      "pose_rmse_dy": 0.08184795081615448,
      "pose_rmse_mean": 0.22807520627975464,
      "rmse_dtheta": 0.04482722654938698,
      "rmse_dx": 0.025973698124289513,
      "rmse_dy": 0.009185620583593845,
      "rmse_mean": 0.026662182062864304,
      "rotation_flip": 0.01149425283074379,
      "sparse_tokens": 9893.0,
      "step": 1178,
      "turn_loss": 0.29033756256103516,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0547760639286378,
      "grad_norm": 0.5586222410202026,
      "learning_rate": 9.805578901540354e-06,
      "loss": 0.1914,
      "mae_dtheta": 0.014172417111694813,
      "mae_dx": 0.002503409516066313,
      "mae_dy": 0.0029608465265482664,
      "pose_mae_dtheta": 0.10091248899698257,
      "pose_mae_dx": 0.03247768059372902,
      "pose_mae_dy": 0.03825172409415245,
      "pose_rmse_dtheta": 0.23586885631084442,
      "pose_rmse_dx": 0.07460592687129974,
      "pose_rmse_dy": 0.10324345529079437,
      "pose_rmse_mean": 0.13790607452392578,
      "rmse_dtheta": 0.028527777642011642,
      "rmse_dx": 0.006855270359665155,
      "rmse_dy": 0.006166995503008366,
      "rmse_mean": 0.01385001465678215,
      "rotation_flip": 0.007936508394777775,
      "sparse_tokens": 32089.0,
      "step": 1179,
      "turn_loss": 0.10833142697811127,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05482252369448058,
      "grad_norm": 0.44855451583862305,
      "learning_rate": 9.805213608366904e-06,
      "loss": 0.1322,
      "mae_dtheta": 0.00905023142695427,
      "mae_dx": 0.002079877769574523,
      "mae_dy": 0.001629205304197967,
      "pose_mae_dtheta": 0.07129506021738052,
      "pose_mae_dx": 0.02457485906779766,
      "pose_mae_dy": 0.026203623041510582,
      "pose_rmse_dtheta": 0.19634969532489777,
      "pose_rmse_dx": 0.06733450293540955,
      "pose_rmse_dy": 0.08712790161371231,
      "pose_rmse_mean": 0.11693736910820007,
      "rmse_dtheta": 0.021971605718135834,
      "rmse_dx": 0.006749993190169334,
      "rmse_dy": 0.0040018255822360516,
      "rmse_mean": 0.010907808318734169,
      "rotation_flip": 0.0017231475794687867,
      "sparse_tokens": 32089.0,
      "step": 1180,
      "turn_loss": 0.06491423398256302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.05486898346032336,
      "grad_norm": 0.4743786156177521,
      "learning_rate": 9.804847979162286e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.031279612332582474,
      "mae_dx": 0.01244647428393364,
      "mae_dy": 0.005321130622178316,
      "pose_mae_dtheta": 0.22620438039302826,
      "pose_mae_dx": 0.09663387387990952,
      "pose_mae_dy": 0.05151065066456795,
      "pose_rmse_dtheta": 0.3724459409713745,
      "pose_rmse_dx": 0.20246069133281708,
      "pose_rmse_dy": 0.11758629977703094,
      "pose_rmse_mean": 0.23083099722862244,
      "rmse_dtheta": 0.04835512116551399,
      "rmse_dx": 0.023482440039515495,
      "rmse_dy": 0.012476630508899689,
      "rmse_mean": 0.02810472995042801,
      "rotation_flip": 0.015037594363093376,
      "sparse_tokens": 18749.0,
      "step": 1181,
      "turn_loss": 0.2804569602012634,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.05491544322616614,
      "grad_norm": 0.546733021736145,
      "learning_rate": 9.804482013952072e-06,
      "loss": 0.1307,
      "mae_dtheta": 0.007859775796532631,
      "mae_dx": 0.0021446195896714926,
      "mae_dy": 0.001416521379724145,
      "pose_mae_dtheta": 0.05350574478507042,
      "pose_mae_dx": 0.02291088178753853,
      "pose_mae_dy": 0.017399204894900322,
      "pose_rmse_dtheta": 0.1678185909986496,
      "pose_rmse_dx": 0.06664197891950607,
      "pose_rmse_dy": 0.05234251171350479,
      "pose_rmse_mean": 0.09560102224349976,
      "rmse_dtheta": 0.02379556931555271,
      "rmse_dx": 0.007158853579312563,
      "rmse_dy": 0.004858081694692373,
      "rmse_mean": 0.011937501840293407,
      "rotation_flip": 0.001607717014849186,
      "sparse_tokens": 32121.0,
      "step": 1182,
      "turn_loss": 0.08539990335702896,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.05496190299200892,
      "grad_norm": 0.5876664519309998,
      "learning_rate": 9.804115712761851e-06,
      "loss": 0.1361,
      "mae_dtheta": 0.030419275164604187,
      "mae_dx": 0.011218396946787834,
      "mae_dy": 0.004253052175045013,
      "pose_mae_dtheta": 0.24319007992744446,
      "pose_mae_dx": 0.09065651148557663,
      "pose_mae_dy": 0.047815579921007156,
      "pose_rmse_dtheta": 0.4066378176212311,
      "pose_rmse_dx": 0.21660344302654266,
      "pose_rmse_dy": 0.11675284802913666,
      "pose_rmse_mean": 0.24666470289230347,
      "rmse_dtheta": 0.04817001894116402,
      "rmse_dx": 0.02362637221813202,
      "rmse_dy": 0.009319351054728031,
      "rmse_mean": 0.027038579806685448,
      "rotation_flip": 0.0060606058686971664,
      "sparse_tokens": 18112.0,
      "step": 1183,
      "turn_loss": 0.24625031650066376,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.0550083627578517,
      "grad_norm": 0.4096260070800781,
      "learning_rate": 9.80374907561724e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.008429047651588917,
      "mae_dx": 0.001953806495293975,
      "mae_dy": 0.001925353892147541,
      "pose_mae_dtheta": 0.062099575996398926,
      "pose_mae_dx": 0.02079898677766323,
      "pose_mae_dy": 0.019502317532896996,
      "pose_rmse_dtheta": 0.17296074330806732,
      "pose_rmse_dx": 0.055046916007995605,
      "pose_rmse_dy": 0.05653156340122223,
      "pose_rmse_mean": 0.09484641253948212,
      "rmse_dtheta": 0.02088876999914646,
      "rmse_dx": 0.005351040977984667,
      "rmse_dy": 0.006108398083597422,
      "rmse_mean": 0.010782736353576183,
      "rotation_flip": 0.004174396861344576,
      "sparse_tokens": 32137.0,
      "step": 1184,
      "turn_loss": 0.07646883279085159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.05505482252369448,
      "grad_norm": 0.47508952021598816,
      "learning_rate": 9.80338210254388e-06,
      "loss": 0.1605,
      "mae_dtheta": 0.014590098522603512,
      "mae_dx": 0.0029464862309396267,
      "mae_dy": 0.0034082182683050632,
      "pose_mae_dtheta": 0.09393371641635895,
      "pose_mae_dx": 0.03710302710533142,
      "pose_mae_dy": 0.04293394088745117,
      "pose_rmse_dtheta": 0.19153733551502228,
      "pose_rmse_dx": 0.07750332355499268,
      "pose_rmse_dy": 0.10143601149320602,
      "pose_rmse_mean": 0.12349222600460052,
      "rmse_dtheta": 0.026439150795340538,
      "rmse_dx": 0.007358860224485397,
      "rmse_dy": 0.006238910835236311,
      "rmse_mean": 0.013345640152692795,
      "rotation_flip": 0.013202437199652195,
      "sparse_tokens": 32137.0,
      "step": 1185,
      "turn_loss": 0.15427672863006592,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16835.0,
      "epoch": 0.055101282289537264,
      "grad_norm": 0.39172354340553284,
      "learning_rate": 9.803014793567429e-06,
      "loss": 0.1091,
      "mae_dtheta": 0.03697677701711655,
      "mae_dx": 0.014421682804822922,
      "mae_dy": 0.003864114638417959,
      "pose_mae_dtheta": 0.2774081230163574,
      "pose_mae_dx": 0.11375624686479568,
      "pose_mae_dy": 0.044806018471717834,
      "pose_rmse_dtheta": 0.4739878475666046,
      "pose_rmse_dx": 0.24413754045963287,
      "pose_rmse_dy": 0.0876975730061531,
      "pose_rmse_mean": 0.2686076760292053,
      "rmse_dtheta": 0.05375782400369644,
      "rmse_dx": 0.02750018611550331,
      "rmse_dy": 0.007172456011176109,
      "rmse_mean": 0.029476825147867203,
      "rotation_flip": 0.013550135307013988,
      "sparse_tokens": 13657.0,
      "step": 1186,
      "turn_loss": 0.26841673254966736,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 11345.0,
      "epoch": 0.05514774205538004,
      "grad_norm": 0.6122571229934692,
      "learning_rate": 9.802647148713575e-06,
      "loss": 0.1843,
      "mae_dtheta": 0.036488424986600876,
      "mae_dx": 0.010641959495842457,
      "mae_dy": 0.007514914032071829,
      "pose_mae_dtheta": 0.27224668860435486,
      "pose_mae_dx": 0.09135567396879196,
      "pose_mae_dy": 0.11440128833055496,
      "pose_rmse_dtheta": 0.5339480042457581,
      "pose_rmse_dx": 0.2270759791135788,
      "pose_rmse_dy": 0.2819776237010956,
      "pose_rmse_mean": 0.34766721725463867,
      "rmse_dtheta": 0.058046720921993256,
      "rmse_dx": 0.023614894598722458,
      "rmse_dy": 0.01602010615170002,
      "rmse_mean": 0.032560572028160095,
      "rotation_flip": 0.008658008649945259,
      "sparse_tokens": 8682.0,
      "step": 1187,
      "turn_loss": 0.30807167291641235,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.055194201821222824,
      "grad_norm": 0.451386958360672,
      "learning_rate": 9.802279168008028e-06,
      "loss": 0.1002,
      "mae_dtheta": 0.009924049489200115,
      "mae_dx": 0.0017137541435658932,
      "mae_dy": 0.002261490561068058,
      "pose_mae_dtheta": 0.07374187558889389,
      "pose_mae_dx": 0.026530934497714043,
      "pose_mae_dy": 0.03097030147910118,
      "pose_rmse_dtheta": 0.15826855599880219,
      "pose_rmse_dx": 0.06205686554312706,
      "pose_rmse_dy": 0.06946256011724472,
      "pose_rmse_mean": 0.09659599512815475,
      "rmse_dtheta": 0.02076970413327217,
      "rmse_dx": 0.004784833174198866,
      "rmse_dy": 0.004771711304783821,
      "rmse_mean": 0.010108750313520432,
      "rotation_flip": 0.004217629786580801,
      "sparse_tokens": 32105.0,
      "step": 1188,
      "turn_loss": 0.08605309575796127,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.0552406615870656,
      "grad_norm": 0.6404330730438232,
      "learning_rate": 9.801910851476524e-06,
      "loss": 0.1421,
      "mae_dtheta": 0.016454581171274185,
      "mae_dx": 0.0029220059514045715,
      "mae_dy": 0.005139483604580164,
      "pose_mae_dtheta": 0.10748932510614395,
      "pose_mae_dx": 0.0438193678855896,
      "pose_mae_dy": 0.05815946310758591,
      "pose_rmse_dtheta": 0.2290414571762085,
      "pose_rmse_dx": 0.11515479534864426,
      "pose_rmse_dy": 0.1552274078130722,
      "pose_rmse_mean": 0.16647456586360931,
      "rmse_dtheta": 0.029205022379755974,
      "rmse_dx": 0.007932783104479313,
      "rmse_dy": 0.01146119087934494,
      "rmse_mean": 0.016199667006731033,
      "rotation_flip": 0.008620689623057842,
      "sparse_tokens": 32105.0,
      "step": 1189,
      "turn_loss": 0.14731664955615997,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.055287121352908385,
      "grad_norm": 0.378493994474411,
      "learning_rate": 9.801542199144814e-06,
      "loss": 0.123,
      "mae_dtheta": 0.007865006104111671,
      "mae_dx": 0.0015841922722756863,
      "mae_dy": 0.0014354657614603639,
      "pose_mae_dtheta": 0.05673958733677864,
      "pose_mae_dx": 0.018881618976593018,
      "pose_mae_dy": 0.02068598009645939,
      "pose_rmse_dtheta": 0.1634913980960846,
      "pose_rmse_dx": 0.046711862087249756,
      "pose_rmse_dy": 0.05732649564743042,
      "pose_rmse_mean": 0.08917658776044846,
      "rmse_dtheta": 0.021304745227098465,
      "rmse_dx": 0.0044137462973594666,
      "rmse_dy": 0.003600915428251028,
      "rmse_mean": 0.009773136116564274,
      "rotation_flip": 0.003544303821399808,
      "sparse_tokens": 32121.0,
      "step": 1190,
      "turn_loss": 0.0602581612765789,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.05533358111875116,
      "grad_norm": 0.5247068405151367,
      "learning_rate": 9.801173211038682e-06,
      "loss": 0.1285,
      "mae_dtheta": 0.036227382719516754,
      "mae_dx": 0.012006443925201893,
      "mae_dy": 0.0048800138756632805,
      "pose_mae_dtheta": 0.27274101972579956,
      "pose_mae_dx": 0.09726599603891373,
      "pose_mae_dy": 0.07051417231559753,
      "pose_rmse_dtheta": 0.45662713050842285,
      "pose_rmse_dx": 0.23122167587280273,
      "pose_rmse_dy": 0.18581834435462952,
      "pose_rmse_mean": 0.29122239351272583,
      "rmse_dtheta": 0.05500848591327667,
      "rmse_dx": 0.02458573505282402,
      "rmse_dy": 0.008772878907620907,
      "rmse_mean": 0.029455702751874924,
      "rotation_flip": 0.01652892492711544,
      "sparse_tokens": 6387.0,
      "step": 1191,
      "turn_loss": 0.22596579790115356,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.05538004088459394,
      "grad_norm": 0.4941072463989258,
      "learning_rate": 9.800803887183931e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.0253756083548069,
      "mae_dx": 0.00811318214982748,
      "mae_dy": 0.0062981885857880116,
      "pose_mae_dtheta": 0.18244153261184692,
      "pose_mae_dx": 0.06749698519706726,
      "pose_mae_dy": 0.0788780152797699,
      "pose_rmse_dtheta": 0.3062829375267029,
      "pose_rmse_dx": 0.16538196802139282,
      "pose_rmse_dy": 0.16509276628494263,
      "pose_rmse_mean": 0.21225255727767944,
      "rmse_dtheta": 0.03979179263114929,
      "rmse_dx": 0.018007656559348106,
      "rmse_dy": 0.012434969656169415,
      "rmse_mean": 0.023411473259329796,
      "rotation_flip": 0.013348164968192577,
      "sparse_tokens": 16928.0,
      "step": 1192,
      "turn_loss": 0.23727405071258545,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 23367.0,
      "epoch": 0.05542650065043672,
      "grad_norm": 0.5259363055229187,
      "learning_rate": 9.800434227606386e-06,
      "loss": 0.1255,
      "mae_dtheta": 0.03884993493556976,
      "mae_dx": 0.01544947363436222,
      "mae_dy": 0.007837929762899876,
      "pose_mae_dtheta": 0.3103778064250946,
      "pose_mae_dx": 0.1279672086238861,
      "pose_mae_dy": 0.09485093504190445,
      "pose_rmse_dtheta": 0.5411608219146729,
      "pose_rmse_dx": 0.25638988614082336,
      "pose_rmse_dy": 0.2240184098482132,
      "pose_rmse_mean": 0.3405230641365051,
      "rmse_dtheta": 0.058376096189022064,
      "rmse_dx": 0.028163807466626167,
      "rmse_dy": 0.0162888802587986,
      "rmse_mean": 0.03427626192569733,
      "rotation_flip": 0.016028495505452156,
      "sparse_tokens": 18459.0,
      "step": 1193,
      "turn_loss": 0.37566763162612915,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 2302.0,
      "epoch": 0.0554729604162795,
      "grad_norm": 0.45153865218162537,
      "learning_rate": 9.8000642323319e-06,
      "loss": 0.1156,
      "mae_dtheta": 0.04804956912994385,
      "mae_dx": 0.03312273323535919,
      "mae_dy": 0.03580854460597038,
      "pose_mae_dtheta": 0.37111330032348633,
      "pose_mae_dx": 0.25343239307403564,
      "pose_mae_dy": 0.27982041239738464,
      "pose_rmse_dtheta": 0.5109307169914246,
      "pose_rmse_dx": 0.4161887764930725,
      "pose_rmse_dy": 0.3989938497543335,
      "pose_rmse_mean": 0.44203779101371765,
      "rmse_dtheta": 0.06320848315954208,
      "rmse_dx": 0.04241902753710747,
      "rmse_dy": 0.04493924602866173,
      "rmse_mean": 0.05018892139196396,
      "rotation_flip": 0.0234375,
      "sparse_tokens": 1835.0,
      "step": 1194,
      "turn_loss": 1.1809442043304443,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.05551942018212228,
      "grad_norm": 0.433437317609787,
      "learning_rate": 9.799693901386346e-06,
      "loss": 0.116,
      "mae_dtheta": 0.014744948595762253,
      "mae_dx": 0.0021759928204119205,
      "mae_dy": 0.003349288133904338,
      "pose_mae_dtheta": 0.10741453617811203,
      "pose_mae_dx": 0.02805008739233017,
      "pose_mae_dy": 0.04177873581647873,
      "pose_rmse_dtheta": 0.247306689620018,
      "pose_rmse_dx": 0.07439850270748138,
      "pose_rmse_dy": 0.09607862681150436,
      "pose_rmse_mean": 0.13926127552986145,
      "rmse_dtheta": 0.029918264597654343,
      "rmse_dx": 0.00667080283164978,
      "rmse_dy": 0.00765325129032135,
      "rmse_mean": 0.01474743988364935,
      "rotation_flip": 0.009462365880608559,
      "sparse_tokens": 32057.0,
      "step": 1195,
      "turn_loss": 0.11111550033092499,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.05556587994796506,
      "grad_norm": 0.7867017984390259,
      "learning_rate": 9.79932323479562e-06,
      "loss": 0.142,
      "mae_dtheta": 0.04750334098935127,
      "mae_dx": 0.01482502743601799,
      "mae_dy": 0.005196226295083761,
      "pose_mae_dtheta": 0.3930084705352783,
      "pose_mae_dx": 0.11936110258102417,
      "pose_mae_dy": 0.08075036853551865,
      "pose_rmse_dtheta": 0.6544386148452759,
      "pose_rmse_dx": 0.2626504898071289,
      "pose_rmse_dy": 0.14916382730007172,
      "pose_rmse_mean": 0.3554176688194275,
      "rmse_dtheta": 0.06638380140066147,
      "rmse_dx": 0.02840234898030758,
      "rmse_dy": 0.009037581272423267,
      "rmse_mean": 0.034607913345098495,
      "rotation_flip": 0.01304347813129425,
      "sparse_tokens": 8488.0,
      "step": 1196,
      "turn_loss": 0.34204575419425964,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.05561233971380784,
      "grad_norm": 0.4080137014389038,
      "learning_rate": 9.798952232585646e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.006761666387319565,
      "mae_dx": 0.0020623754244297743,
      "mae_dy": 0.000883770058862865,
      "pose_mae_dtheta": 0.04948185756802559,
      "pose_mae_dx": 0.01807865872979164,
      "pose_mae_dy": 0.012715250253677368,
      "pose_rmse_dtheta": 0.17007090151309967,
      "pose_rmse_dx": 0.05097394436597824,
      "pose_rmse_dy": 0.03625651076436043,
      "pose_rmse_mean": 0.08576712012290955,
      "rmse_dtheta": 0.021758701652288437,
      "rmse_dx": 0.006496579851955175,
      "rmse_dy": 0.002283803652971983,
      "rmse_mean": 0.010179695673286915,
      "rotation_flip": 0.0013486177194863558,
      "sparse_tokens": 32137.0,
      "step": 1197,
      "turn_loss": 0.05143081769347191,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.05565879947965062,
      "grad_norm": 0.6264904737472534,
      "learning_rate": 9.798580894782366e-06,
      "loss": 0.15,
      "mae_dtheta": 0.016664963215589523,
      "mae_dx": 0.004543135408312082,
      "mae_dy": 0.005439478904008865,
      "pose_mae_dtheta": 0.12399327754974365,
      "pose_mae_dx": 0.0557171069085598,
      "pose_mae_dy": 0.056218262761831284,
      "pose_rmse_dtheta": 0.2653612196445465,
      "pose_rmse_dx": 0.15079911053180695,
      "pose_rmse_dy": 0.1346723884344101,
      "pose_rmse_mean": 0.1836109161376953,
      "rmse_dtheta": 0.0316152386367321,
      "rmse_dx": 0.012165394611656666,
      "rmse_dy": 0.012165642343461514,
      "rmse_mean": 0.01864875853061676,
      "rotation_flip": 0.008559200912714005,
      "sparse_tokens": 32121.0,
      "step": 1198,
      "turn_loss": 0.14859013259410858,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.0557052592454934,
      "grad_norm": 1.1923036575317383,
      "learning_rate": 9.798209221411748e-06,
      "loss": 0.282,
      "mae_dtheta": 0.04979470372200012,
      "mae_dx": 0.01693965494632721,
      "mae_dy": 0.016523797065019608,
      "pose_mae_dtheta": 0.3893250823020935,
      "pose_mae_dx": 0.1276518851518631,
      "pose_mae_dy": 0.1428070068359375,
      "pose_rmse_dtheta": 0.6419026851654053,
      "pose_rmse_dx": 0.2526858150959015,
      "pose_rmse_dy": 0.32996606826782227,
      "pose_rmse_mean": 0.40818485617637634,
      "rmse_dtheta": 0.07001397013664246,
      "rmse_dx": 0.027033042162656784,
      "rmse_dy": 0.02824201062321663,
      "rmse_mean": 0.04176300764083862,
      "rotation_flip": 0.015384615398943424,
      "sparse_tokens": 3108.0,
      "step": 1199,
      "turn_loss": 0.4358455538749695,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.05575171901133618,
      "grad_norm": 0.484773188829422,
      "learning_rate": 9.797837212499783e-06,
      "loss": 0.0864,
      "mae_dtheta": 0.01609036698937416,
      "mae_dx": 0.002470972016453743,
      "mae_dy": 0.003570999950170517,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4847731590270996,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 139.849609375,
      "model/head/act_norm_mean": 100.96871054292929,
      "model/head/act_norm_min": 63.575965881347656,
      "model/head/act_over_embed": 69.3866431690623,
      "model/head/grad_frac": 0.1243627592921257,
      "model/head/grad_norm": 0.060287728905677795,
      "model/head/grad_zero_frac": 0.00014245502825360745,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6802053740530303,
      "model/head/update_ratio": 0.001050412654876709,
      "model/head/weight_delta": 3.854020833969116,
      "model/head/weight_delta_rel": 0.06761094182729721,
      "model/head/weight_norm": 57.394325256347656,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4121563136577606,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41207976488289855,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41201528906822205,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28318507237906976,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07287178188562393,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0353262834250927,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5198754129955947,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001150630065239966,
      "model/modality_embedder.encoders.pose/weight_delta": 1.2155483961105347,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.039715755730867386,
      "model/modality_embedder.encoders.pose/weight_norm": 30.701684951782227,
      "model/modality_embedder/grad_frac": 0.07287178188562393,
      "model/modality_embedder/grad_norm": 0.0353262834250927,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5198754129955947,
      "model/modality_embedder/update_ratio": 0.001150630065239966,
      "model/modality_embedder/weight_delta": 1.2155483961105347,
      "model/modality_embedder/weight_delta_rel": 0.039715755730867386,
      "model/modality_embedder/weight_norm": 30.701684951782227,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.86116790771484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.487138247554913,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.986091613769531,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.45337193162493,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1216522678732872,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.058973755687475204,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0021417883690446615,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.6541474461555481,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.023837527260184288,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.534820556640625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.60444641113281,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.54832050665384,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.179426193237305,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.182626315022553,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.1094055324792862,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05303686484694481,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001826109946705401,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.802844226360321,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.02781115099787712,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.04363250732422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.63500213623047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.570509159050825,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.583104133605957,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.5722932889782,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11392054706811905,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05522562190890312,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001842797384597361,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.842337429523468,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.028284113854169846,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.96836280822754,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.7901382446289,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.489711099086097,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.619978904724121,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.891186830022093,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1724938303232193,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08362037688493729,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002844547852873802,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.715753972530365,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.02446107380092144,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.396718978881836,
      "model/normalizer/grad_frac": 0.6280983686447144,
      "model/normalizer/grad_norm": 0.3044852316379547,
      "model/normalizer/grad_zero_frac": 0.00010753819515230134,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003911725245416164,
      "model/normalizer/weight_delta": 1.5528041124343872,
      "model/normalizer/weight_delta_rel": 0.019999217242002487,
      "model/normalizer/weight_norm": 77.839111328125,
      "pose_mae_dtheta": 0.10480594635009766,
      "pose_mae_dx": 0.03895711526274681,
      "pose_mae_dy": 0.04152883589267731,
      "pose_rmse_dtheta": 0.2252650260925293,
      "pose_rmse_dx": 0.08664049208164215,
      "pose_rmse_dy": 0.09090682119131088,
      "pose_rmse_mean": 0.1342707872390747,
      "rmse_dtheta": 0.03056539036333561,
      "rmse_dx": 0.006807958707213402,
      "rmse_dy": 0.007474449463188648,
      "rmse_mean": 0.014949265867471695,
      "rotation_flip": 0.009168511256575584,
      "sparse_tokens": 32137.0,
      "step": 1200,
      "turn_loss": 0.11027806252241135,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.05575171901133618,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.32812854647636414,
      "eval_objectnav_nopose_mae_dtheta": 0.04086168855428696,
      "eval_objectnav_nopose_mae_dx": 0.014360921457409859,
      "eval_objectnav_nopose_mae_dy": 0.005334311630576849,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3334239721298218,
      "eval_objectnav_nopose_pose_mae_dx": 0.11657143384218216,
      "eval_objectnav_nopose_pose_mae_dy": 0.06284765899181366,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5550165176391602,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24982747435569763,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14234697818756104,
      "eval_objectnav_nopose_pose_rmse_mean": 0.31573033332824707,
      "eval_objectnav_nopose_rmse_dtheta": 0.0584569051861763,
      "eval_objectnav_nopose_rmse_dx": 0.02726278267800808,
      "eval_objectnav_nopose_rmse_dy": 0.010757849551737309,
      "eval_objectnav_nopose_rmse_mean": 0.03215917944908142,
      "eval_objectnav_nopose_rotation_flip": 0.015091966837644577,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.32812854647636414,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 1200
    },
    {
      "epoch": 0.05575171901133618,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2990291118621826,
      "eval_objectnav_pose_mae_dtheta": 0.03599844500422478,
      "eval_objectnav_pose_mae_dx": 0.012437941506505013,
      "eval_objectnav_pose_mae_dy": 0.005133082624524832,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2782374322414398,
      "eval_objectnav_pose_pose_mae_dx": 0.10026182979345322,
      "eval_objectnav_pose_pose_mae_dy": 0.056033000349998474,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.48165708780288696,
      "eval_objectnav_pose_pose_rmse_dx": 0.22453249990940094,
      "eval_objectnav_pose_pose_rmse_dy": 0.13085956871509552,
      "eval_objectnav_pose_pose_rmse_mean": 0.279016375541687,
      "eval_objectnav_pose_rmse_dtheta": 0.05331149697303772,
      "eval_objectnav_pose_rmse_dx": 0.02499638870358467,
      "eval_objectnav_pose_rmse_dy": 0.010754439048469067,
      "eval_objectnav_pose_rmse_mean": 0.029687440022826195,
      "eval_objectnav_pose_rotation_flip": 0.014773505739867687,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2990291118621826,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 1200
    },
    {
      "epoch": 0.05575171901133618,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10758223384618759,
      "eval_pointnav_mae_dtheta": 0.012144549749791622,
      "eval_pointnav_mae_dx": 0.0030436322558671236,
      "eval_pointnav_mae_dy": 0.002828653436154127,
      "eval_pointnav_pose_mae_dtheta": 0.08669578284025192,
      "eval_pointnav_pose_mae_dx": 0.03401640057563782,
      "eval_pointnav_pose_mae_dy": 0.03349597007036209,
      "eval_pointnav_pose_rmse_dtheta": 0.22053392231464386,
      "eval_pointnav_pose_rmse_dx": 0.0948336124420166,
      "eval_pointnav_pose_rmse_dy": 0.09160778671503067,
      "eval_pointnav_pose_rmse_mean": 0.13565844297409058,
      "eval_pointnav_rmse_dtheta": 0.027158046141266823,
      "eval_pointnav_rmse_dx": 0.008974457159638405,
      "eval_pointnav_rmse_dy": 0.007155110593885183,
      "eval_pointnav_rmse_mean": 0.014429204165935516,
      "eval_pointnav_rotation_flip": 0.006116987206041813,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10758223384618759,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 1200
    },
    {
      "epoch": 0.05575171901133618,
      "eval_loss": 0.24491329739491144,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.32812854647636414,
      "eval_objectnav_nopose_mae_dtheta": 0.04086168855428696,
      "eval_objectnav_nopose_mae_dx": 0.014360921457409859,
      "eval_objectnav_nopose_mae_dy": 0.005334311630576849,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3334239721298218,
      "eval_objectnav_nopose_pose_mae_dx": 0.11657143384218216,
      "eval_objectnav_nopose_pose_mae_dy": 0.06284765899181366,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5550165176391602,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24982747435569763,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14234697818756104,
      "eval_objectnav_nopose_pose_rmse_mean": 0.31573033332824707,
      "eval_objectnav_nopose_rmse_dtheta": 0.0584569051861763,
      "eval_objectnav_nopose_rmse_dx": 0.02726278267800808,
      "eval_objectnav_nopose_rmse_dy": 0.010757849551737309,
      "eval_objectnav_nopose_rmse_mean": 0.03215917944908142,
      "eval_objectnav_nopose_rotation_flip": 0.015091966837644577,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.32812854647636414,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2990291118621826,
      "eval_objectnav_pose_mae_dtheta": 0.03599844500422478,
      "eval_objectnav_pose_mae_dx": 0.012437941506505013,
      "eval_objectnav_pose_mae_dy": 0.005133082624524832,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2782374322414398,
      "eval_objectnav_pose_pose_mae_dx": 0.10026182979345322,
      "eval_objectnav_pose_pose_mae_dy": 0.056033000349998474,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.48165708780288696,
      "eval_objectnav_pose_pose_rmse_dx": 0.22453249990940094,
      "eval_objectnav_pose_pose_rmse_dy": 0.13085956871509552,
      "eval_objectnav_pose_pose_rmse_mean": 0.279016375541687,
      "eval_objectnav_pose_rmse_dtheta": 0.05331149697303772,
      "eval_objectnav_pose_rmse_dx": 0.02499638870358467,
      "eval_objectnav_pose_rmse_dy": 0.010754439048469067,
      "eval_objectnav_pose_rmse_mean": 0.029687440022826195,
      "eval_objectnav_pose_rotation_flip": 0.014773505739867687,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2990291118621826,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10758223384618759,
      "eval_pointnav_mae_dtheta": 0.012144549749791622,
      "eval_pointnav_mae_dx": 0.0030436322558671236,
      "eval_pointnav_mae_dy": 0.002828653436154127,
      "eval_pointnav_pose_mae_dtheta": 0.08669578284025192,
      "eval_pointnav_pose_mae_dx": 0.03401640057563782,
      "eval_pointnav_pose_mae_dy": 0.03349597007036209,
      "eval_pointnav_pose_rmse_dtheta": 0.22053392231464386,
      "eval_pointnav_pose_rmse_dx": 0.0948336124420166,
      "eval_pointnav_pose_rmse_dy": 0.09160778671503067,
      "eval_pointnav_pose_rmse_mean": 0.13565844297409058,
      "eval_pointnav_rmse_dtheta": 0.027158046141266823,
      "eval_pointnav_rmse_dx": 0.008974457159638405,
      "eval_pointnav_rmse_dy": 0.007155110593885183,
      "eval_pointnav_rmse_mean": 0.014429204165935516,
      "eval_pointnav_rotation_flip": 0.006116987206041813,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10758223384618759,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 1200
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.055798178777178964,
      "grad_norm": 0.5021202564239502,
      "learning_rate": 9.797464868072489e-06,
      "loss": 0.1511,
      "mae_dtheta": 0.0384855717420578,
      "mae_dx": 0.012363673187792301,
      "mae_dy": 0.010247514583170414,
      "pose_mae_dtheta": 0.2776995897293091,
      "pose_mae_dx": 0.11723752319812775,
      "pose_mae_dy": 0.15033577382564545,
      "pose_rmse_dtheta": 0.5153399109840393,
      "pose_rmse_dx": 0.2683093249797821,
      "pose_rmse_dy": 0.32462769746780396,
      "pose_rmse_mean": 0.36942562460899353,
      "rmse_dtheta": 0.05728542432188988,
      "rmse_dx": 0.02648773603141308,
      "rmse_dy": 0.021097635850310326,
      "rmse_mean": 0.034956932067871094,
      "rotation_flip": 0.007005253806710243,
      "sparse_tokens": 9296.0,
      "step": 1201,
      "turn_loss": 0.36100906133651733,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.05584463854302174,
      "grad_norm": 0.5145487785339355,
      "learning_rate": 9.797092188155899e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.035302381962537766,
      "mae_dx": 0.012337158434092999,
      "mae_dy": 0.0036794075276702642,
      "pose_mae_dtheta": 0.28985702991485596,
      "pose_mae_dx": 0.09232113510370255,
      "pose_mae_dy": 0.05417764186859131,
      "pose_rmse_dtheta": 0.5227584838867188,
      "pose_rmse_dx": 0.1937209665775299,
      "pose_rmse_dy": 0.16845105588436127,
      "pose_rmse_mean": 0.2949768304824829,
      "rmse_dtheta": 0.054454077035188675,
      "rmse_dx": 0.02392171137034893,
      "rmse_dy": 0.008243050426244736,
      "rmse_mean": 0.02887294813990593,
      "rotation_flip": 0.013493252918124199,
      "sparse_tokens": 12424.0,
      "step": 1202,
      "turn_loss": 0.2417995035648346,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.055891098308864524,
      "grad_norm": 0.884269654750824,
      "learning_rate": 9.796719172776079e-06,
      "loss": 0.2181,
      "mae_dtheta": 0.024254046380519867,
      "mae_dx": 0.00928475335240364,
      "mae_dy": 0.0034740506671369076,
      "pose_mae_dtheta": 0.17197778820991516,
      "pose_mae_dx": 0.0791340097784996,
      "pose_mae_dy": 0.04720382019877434,
      "pose_rmse_dtheta": 0.3710271716117859,
      "pose_rmse_dx": 0.20412780344486237,
      "pose_rmse_dy": 0.09871229529380798,
      "pose_rmse_mean": 0.22462241351604462,
      "rmse_dtheta": 0.04286511242389679,
      "rmse_dx": 0.02178223989903927,
      "rmse_dy": 0.0064104534685611725,
      "rmse_mean": 0.023685937747359276,
      "rotation_flip": 0.0034904014319181442,
      "sparse_tokens": 9764.0,
      "step": 1203,
      "turn_loss": 0.18251192569732666,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 694.0,
      "epoch": 0.0559375580747073,
      "grad_norm": 0.38691845536231995,
      "learning_rate": 9.796345821959113e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.03884339705109596,
      "mae_dx": 0.010683280415832996,
      "mae_dy": 0.014412450604140759,
      "pose_mae_dtheta": 0.3032744824886322,
      "pose_mae_dx": 0.048558399081230164,
      "pose_mae_dy": 0.321949303150177,
      "pose_rmse_dtheta": 0.36543628573417664,
      "pose_rmse_dx": 0.08171768486499786,
      "pose_rmse_dy": 0.38517332077026367,
      "pose_rmse_mean": 0.27744245529174805,
      "rmse_dtheta": 0.04276950657367706,
      "rmse_dx": 0.01767556555569172,
      "rmse_dy": 0.01747426949441433,
      "rmse_mean": 0.025973115116357803,
      "rotation_flip": 0.0,
      "sparse_tokens": 668.0,
      "step": 1204,
      "turn_loss": 0.6106255054473877,
      "turns": 2.0,
      "turns_per_sample": 2.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.055984017840550085,
      "grad_norm": 0.5541227459907532,
      "learning_rate": 9.795972135731108e-06,
      "loss": 0.156,
      "mae_dtheta": 0.01113959215581417,
      "mae_dx": 0.0019462958443909883,
      "mae_dy": 0.0024321777746081352,
      "pose_mae_dtheta": 0.0751110166311264,
      "pose_mae_dx": 0.023518694564700127,
      "pose_mae_dy": 0.03180452808737755,
      "pose_rmse_dtheta": 0.18471205234527588,
      "pose_rmse_dx": 0.0554368682205677,
      "pose_rmse_dy": 0.07413531839847565,
      "pose_rmse_mean": 0.10476141422986984,
      "rmse_dtheta": 0.023334575816988945,
      "rmse_dx": 0.0055570583790540695,
      "rmse_dy": 0.004833477083593607,
      "rmse_mean": 0.011241704225540161,
      "rotation_flip": 0.0058139534667134285,
      "sparse_tokens": 32073.0,
      "step": 1205,
      "turn_loss": 0.09774094074964523,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.05603047760639286,
      "grad_norm": 0.6180552840232849,
      "learning_rate": 9.795598114118199e-06,
      "loss": 0.1434,
      "mae_dtheta": 0.043290041387081146,
      "mae_dx": 0.011949227191507816,
      "mae_dy": 0.009418454952538013,
      "pose_mae_dtheta": 0.35719168186187744,
      "pose_mae_dx": 0.09071952104568481,
      "pose_mae_dy": 0.11693304777145386,
      "pose_rmse_dtheta": 0.6151050329208374,
      "pose_rmse_dx": 0.18054787814617157,
      "pose_rmse_dy": 0.27312836050987244,
      "pose_rmse_mean": 0.35626041889190674,
      "rmse_dtheta": 0.06104770302772522,
      "rmse_dx": 0.023855173960328102,
      "rmse_dy": 0.02051313780248165,
      "rmse_mean": 0.03513867408037186,
      "rotation_flip": 0.006666666828095913,
      "sparse_tokens": 7640.0,
      "step": 1206,
      "turn_loss": 0.3008108139038086,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.056076937372235645,
      "grad_norm": 0.5056016445159912,
      "learning_rate": 9.79522375714654e-06,
      "loss": 0.1056,
      "mae_dtheta": 0.013875988312065601,
      "mae_dx": 0.002769604790955782,
      "mae_dy": 0.0034642040263861418,
      "pose_mae_dtheta": 0.09146246314048767,
      "pose_mae_dx": 0.030803119763731956,
      "pose_mae_dy": 0.03570852428674698,
      "pose_rmse_dtheta": 0.1808527559041977,
      "pose_rmse_dx": 0.07769958674907684,
      "pose_rmse_dy": 0.07984033226966858,
      "pose_rmse_mean": 0.1127975583076477,
      "rmse_dtheta": 0.026628069579601288,
      "rmse_dx": 0.0079009048640728,
      "rmse_dy": 0.007970944978296757,
      "rmse_mean": 0.014166640117764473,
      "rotation_flip": 0.009049774147570133,
      "sparse_tokens": 32137.0,
      "step": 1207,
      "turn_loss": 0.12982115149497986,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.05612339713807842,
      "grad_norm": 0.5840367674827576,
      "learning_rate": 9.794849064842307e-06,
      "loss": 0.1501,
      "mae_dtheta": 0.011273556388914585,
      "mae_dx": 0.002883725566789508,
      "mae_dy": 0.0024506854824721813,
      "pose_mae_dtheta": 0.08340240269899368,
      "pose_mae_dx": 0.03176748752593994,
      "pose_mae_dy": 0.03328557685017586,
      "pose_rmse_dtheta": 0.17743638157844543,
      "pose_rmse_dx": 0.07437960803508759,
      "pose_rmse_dy": 0.07525070756673813,
      "pose_rmse_mean": 0.10902222990989685,
      "rmse_dtheta": 0.02313642017543316,
      "rmse_dx": 0.009066407568752766,
      "rmse_dy": 0.005969701800495386,
      "rmse_mean": 0.012724177911877632,
      "rotation_flip": 0.004759844392538071,
      "sparse_tokens": 32073.0,
      "step": 1208,
      "turn_loss": 0.09299110621213913,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.056169856903921206,
      "grad_norm": 0.6369516253471375,
      "learning_rate": 9.794474037231709e-06,
      "loss": 0.1808,
      "mae_dtheta": 0.02553595043718815,
      "mae_dx": 0.010707119479775429,
      "mae_dy": 0.002980252727866173,
      "pose_mae_dtheta": 0.1812461018562317,
      "pose_mae_dx": 0.082840196788311,
      "pose_mae_dy": 0.031915970146656036,
      "pose_rmse_dtheta": 0.31111830472946167,
      "pose_rmse_dx": 0.16847899556159973,
      "pose_rmse_dy": 0.070758156478405,
      "pose_rmse_mean": 0.1834518164396286,
      "rmse_dtheta": 0.042510226368904114,
      "rmse_dx": 0.0210788082331419,
      "rmse_dy": 0.005931331310421228,
      "rmse_mean": 0.023173457011580467,
      "rotation_flip": 0.007614213041961193,
      "sparse_tokens": 6560.0,
      "step": 1209,
      "turn_loss": 0.20266412198543549,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05621631666976398,
      "grad_norm": 0.5251211524009705,
      "learning_rate": 9.794098674340966e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.010738570243120193,
      "mae_dx": 0.0016548000276088715,
      "mae_dy": 0.002027931623160839,
      "pose_mae_dtheta": 0.07319324463605881,
      "pose_mae_dx": 0.02388073317706585,
      "pose_mae_dy": 0.031072551384568214,
      "pose_rmse_dtheta": 0.15171688795089722,
      "pose_rmse_dx": 0.05710543319582939,
      "pose_rmse_dy": 0.0744679719209671,
      "pose_rmse_mean": 0.0944301038980484,
      "rmse_dtheta": 0.021642161533236504,
      "rmse_dx": 0.005122112575918436,
      "rmse_dy": 0.004007826559245586,
      "rmse_mean": 0.010257367044687271,
      "rotation_flip": 0.004854368977248669,
      "sparse_tokens": 32089.0,
      "step": 1210,
      "turn_loss": 0.08356545865535736,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.056262776435606766,
      "grad_norm": 0.500941276550293,
      "learning_rate": 9.79372297619633e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.01784311793744564,
      "mae_dx": 0.00425942987203598,
      "mae_dy": 0.005318133160471916,
      "pose_mae_dtheta": 0.13439926505088806,
      "pose_mae_dx": 0.052200332283973694,
      "pose_mae_dy": 0.051878221333026886,
      "pose_rmse_dtheta": 0.28803446888923645,
      "pose_rmse_dx": 0.1297656148672104,
      "pose_rmse_dy": 0.11790517717599869,
      "pose_rmse_mean": 0.17856842279434204,
      "rmse_dtheta": 0.03455306962132454,
      "rmse_dx": 0.011454208754003048,
      "rmse_dy": 0.01154156681150198,
      "rmse_mean": 0.019182950258255005,
      "rotation_flip": 0.006657322868704796,
      "sparse_tokens": 32105.0,
      "step": 1211,
      "turn_loss": 0.1657814234495163,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.05630923620144954,
      "grad_norm": 0.6310669779777527,
      "learning_rate": 9.793346942824073e-06,
      "loss": 0.1853,
      "mae_dtheta": 0.017544575035572052,
      "mae_dx": 0.00473469402641058,
      "mae_dy": 0.004757699556648731,
      "pose_mae_dtheta": 0.1282271295785904,
      "pose_mae_dx": 0.05215229094028473,
      "pose_mae_dy": 0.04438319802284241,
      "pose_rmse_dtheta": 0.28004342317581177,
      "pose_rmse_dx": 0.1526937633752823,
      "pose_rmse_dy": 0.09400501847267151,
      "pose_rmse_mean": 0.17558073997497559,
      "rmse_dtheta": 0.03583182394504547,
      "rmse_dx": 0.013480952009558678,
      "rmse_dy": 0.011345168575644493,
      "rmse_mean": 0.020219316706061363,
      "rotation_flip": 0.00982111506164074,
      "sparse_tokens": 32105.0,
      "step": 1212,
      "turn_loss": 0.19079262018203735,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05635569596729233,
      "grad_norm": 0.580400288105011,
      "learning_rate": 9.792970574250493e-06,
      "loss": 0.1628,
      "mae_dtheta": 0.013610309921205044,
      "mae_dx": 0.002647621324285865,
      "mae_dy": 0.0037022242322564125,
      "pose_mae_dtheta": 0.08673654496669769,
      "pose_mae_dx": 0.02451174147427082,
      "pose_mae_dy": 0.04041815549135208,
      "pose_rmse_dtheta": 0.19129768013954163,
      "pose_rmse_dx": 0.05997680872678757,
      "pose_rmse_dy": 0.12386927008628845,
      "pose_rmse_mean": 0.12504792213439941,
      "rmse_dtheta": 0.02496941015124321,
      "rmse_dx": 0.007357385940849781,
      "rmse_dy": 0.009112549014389515,
      "rmse_mean": 0.01381311472505331,
      "rotation_flip": 0.010003705509006977,
      "sparse_tokens": 32089.0,
      "step": 1213,
      "turn_loss": 0.10373834520578384,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.056402155733135104,
      "grad_norm": 0.6600459814071655,
      "learning_rate": 9.792593870501907e-06,
      "loss": 0.1361,
      "mae_dtheta": 0.01190866157412529,
      "mae_dx": 0.0021880657877773046,
      "mae_dy": 0.0026370901614427567,
      "pose_mae_dtheta": 0.08451508730649948,
      "pose_mae_dx": 0.03058556281030178,
      "pose_mae_dy": 0.035945210605859756,
      "pose_rmse_dtheta": 0.19143454730510712,
      "pose_rmse_dx": 0.07959830015897751,
      "pose_rmse_dy": 0.07301435619592667,
      "pose_rmse_mean": 0.1146823987364769,
      "rmse_dtheta": 0.023009633645415306,
      "rmse_dx": 0.007080698385834694,
      "rmse_dy": 0.00541442958638072,
      "rmse_mean": 0.011834921315312386,
      "rotation_flip": 0.004823747556656599,
      "sparse_tokens": 32073.0,
      "step": 1214,
      "turn_loss": 0.08275602012872696,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.05644861549897789,
      "grad_norm": 0.7717254757881165,
      "learning_rate": 9.79221683160466e-06,
      "loss": 0.2489,
      "mae_dtheta": 0.03153585270047188,
      "mae_dx": 0.007789594121277332,
      "mae_dy": 0.004532075021415949,
      "pose_mae_dtheta": 0.25363415479660034,
      "pose_mae_dx": 0.04980006441473961,
      "pose_mae_dy": 0.05897994339466095,
      "pose_rmse_dtheta": 0.4623081088066101,
      "pose_rmse_dx": 0.14978863298892975,
      "pose_rmse_dy": 0.1644746959209442,
      "pose_rmse_mean": 0.2588571310043335,
      "rmse_dtheta": 0.05507294461131096,
      "rmse_dx": 0.020172562450170517,
      "rmse_dy": 0.008729762397706509,
      "rmse_mean": 0.027991756796836853,
      "rotation_flip": 0.017316017299890518,
      "sparse_tokens": 4213.0,
      "step": 1215,
      "turn_loss": 0.21230033040046692,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.056495075264820664,
      "grad_norm": 0.5215575098991394,
      "learning_rate": 9.791839457585118e-06,
      "loss": 0.1637,
      "mae_dtheta": 0.011008985340595245,
      "mae_dx": 0.0015287402784451842,
      "mae_dy": 0.002196108689531684,
      "pose_mae_dtheta": 0.07360374182462692,
      "pose_mae_dx": 0.022264039143919945,
      "pose_mae_dy": 0.030331293120980263,
      "pose_rmse_dtheta": 0.19012822210788727,
      "pose_rmse_dx": 0.05789323151111603,
      "pose_rmse_dy": 0.07375865429639816,
      "pose_rmse_mean": 0.10726004093885422,
      "rmse_dtheta": 0.02480423077940941,
      "rmse_dx": 0.0046413131058216095,
      "rmse_dy": 0.004883113317191601,
      "rmse_mean": 0.011442886665463448,
      "rotation_flip": 0.005775895435363054,
      "sparse_tokens": 32121.0,
      "step": 1216,
      "turn_loss": 0.08441181480884552,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.05654153503066345,
      "grad_norm": 0.6845473647117615,
      "learning_rate": 9.791461748469669e-06,
      "loss": 0.1578,
      "mae_dtheta": 0.012253529392182827,
      "mae_dx": 0.0023452742025256157,
      "mae_dy": 0.002641895553097129,
      "pose_mae_dtheta": 0.07996749132871628,
      "pose_mae_dx": 0.02790037915110588,
      "pose_mae_dy": 0.030946359038352966,
      "pose_rmse_dtheta": 0.18853098154067993,
      "pose_rmse_dx": 0.07076702266931534,
      "pose_rmse_dy": 0.08353912085294724,
      "pose_rmse_mean": 0.11427904665470123,
      "rmse_dtheta": 0.024932481348514557,
      "rmse_dx": 0.006830792408436537,
      "rmse_dy": 0.0063799899071455,
      "rmse_mean": 0.01271442137658596,
      "rotation_flip": 0.007212405558675528,
      "sparse_tokens": 32169.0,
      "step": 1217,
      "turn_loss": 0.10257276892662048,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15868.0,
      "epoch": 0.056587994796506225,
      "grad_norm": 0.4183623492717743,
      "learning_rate": 9.79108370428473e-06,
      "loss": 0.125,
      "mae_dtheta": 0.03849748894572258,
      "mae_dx": 0.01127388421446085,
      "mae_dy": 0.004989593289792538,
      "pose_mae_dtheta": 0.3060363233089447,
      "pose_mae_dx": 0.09965530782938004,
      "pose_mae_dy": 0.05970149487257004,
      "pose_rmse_dtheta": 0.5033934712409973,
      "pose_rmse_dx": 0.21612851321697235,
      "pose_rmse_dy": 0.11198288947343826,
      "pose_rmse_mean": 0.27716830372810364,
      "rmse_dtheta": 0.055295512080192566,
      "rmse_dx": 0.022431856021285057,
      "rmse_dy": 0.010748333297669888,
      "rmse_mean": 0.029491901397705078,
      "rotation_flip": 0.01703800819814205,
      "sparse_tokens": 12887.0,
      "step": 1218,
      "turn_loss": 0.31157732009887695,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05663445456234901,
      "grad_norm": 0.7499542832374573,
      "learning_rate": 9.790705325056735e-06,
      "loss": 0.1197,
      "mae_dtheta": 0.012093955650925636,
      "mae_dx": 0.0019409446977078915,
      "mae_dy": 0.0021385150030255318,
      "pose_mae_dtheta": 0.08394016325473785,
      "pose_mae_dx": 0.024869775399565697,
      "pose_mae_dy": 0.028802789747714996,
      "pose_rmse_dtheta": 0.22123588621616364,
      "pose_rmse_dx": 0.0656776949763298,
      "pose_rmse_dy": 0.07088563591241837,
      "pose_rmse_mean": 0.11926640570163727,
      "rmse_dtheta": 0.026829591020941734,
      "rmse_dx": 0.005942238494753838,
      "rmse_dy": 0.005221192259341478,
      "rmse_mean": 0.012664340436458588,
      "rotation_flip": 0.0019351717783138156,
      "sparse_tokens": 32089.0,
      "step": 1219,
      "turn_loss": 0.08462511003017426,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.056680914328191785,
      "grad_norm": 0.6920489072799683,
      "learning_rate": 9.790326610812146e-06,
      "loss": 0.1477,
      "mae_dtheta": 0.013729768805205822,
      "mae_dx": 0.0019680014811456203,
      "mae_dy": 0.002271737437695265,
      "pose_mae_dtheta": 0.09758436679840088,
      "pose_mae_dx": 0.026565685868263245,
      "pose_mae_dy": 0.0330674946308136,
      "pose_rmse_dtheta": 0.23653629422187805,
      "pose_rmse_dx": 0.06279338151216507,
      "pose_rmse_dy": 0.07432012259960175,
      "pose_rmse_mean": 0.12454992532730103,
      "rmse_dtheta": 0.028344662860035896,
      "rmse_dx": 0.005835372023284435,
      "rmse_dy": 0.004631203133612871,
      "rmse_mean": 0.012937079183757305,
      "rotation_flip": 0.004446241073310375,
      "sparse_tokens": 32105.0,
      "step": 1220,
      "turn_loss": 0.11015868932008743,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.05672737409403457,
      "grad_norm": 0.6193857789039612,
      "learning_rate": 9.789947561577445e-06,
      "loss": 0.1354,
      "mae_dtheta": 0.024663353338837624,
      "mae_dx": 0.007502892054617405,
      "mae_dy": 0.0018099433509632945,
      "pose_mae_dtheta": 0.2125369906425476,
      "pose_mae_dx": 0.06366624683141708,
      "pose_mae_dy": 0.02204187586903572,
      "pose_rmse_dtheta": 0.41322949528694153,
      "pose_rmse_dx": 0.17041248083114624,
      "pose_rmse_dy": 0.05346155911684036,
      "pose_rmse_mean": 0.21236786246299744,
      "rmse_dtheta": 0.04364883899688721,
      "rmse_dx": 0.01855739951133728,
      "rmse_dy": 0.003896250855177641,
      "rmse_mean": 0.022034164518117905,
      "rotation_flip": 0.022038567811250687,
      "sparse_tokens": 8876.0,
      "step": 1221,
      "turn_loss": 0.1477462351322174,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.056773833859877346,
      "grad_norm": 0.624664843082428,
      "learning_rate": 9.78956817737914e-06,
      "loss": 0.1901,
      "mae_dtheta": 0.034536030143499374,
      "mae_dx": 0.012934152968227863,
      "mae_dy": 0.004035574849694967,
      "pose_mae_dtheta": 0.3021390736103058,
      "pose_mae_dx": 0.10166161507368088,
      "pose_mae_dy": 0.0685666874051094,
      "pose_rmse_dtheta": 0.5711723566055298,
      "pose_rmse_dx": 0.23119942843914032,
      "pose_rmse_dy": 0.17648039758205414,
      "pose_rmse_mean": 0.3262840807437897,
      "rmse_dtheta": 0.05581238865852356,
      "rmse_dx": 0.025821935385465622,
      "rmse_dy": 0.00737005053088069,
      "rmse_mean": 0.02966812625527382,
      "rotation_flip": 0.007766990456730127,
      "sparse_tokens": 10880.0,
      "step": 1222,
      "turn_loss": 0.27174144983291626,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.05682029362572013,
      "grad_norm": 0.5259042382240295,
      "learning_rate": 9.789188458243764e-06,
      "loss": 0.0911,
      "mae_dtheta": 0.010976816527545452,
      "mae_dx": 0.0018582703778520226,
      "mae_dy": 0.00277977273799479,
      "pose_mae_dtheta": 0.0738651305437088,
      "pose_mae_dx": 0.024687988683581352,
      "pose_mae_dy": 0.035644881427288055,
      "pose_rmse_dtheta": 0.1477290540933609,
      "pose_rmse_dx": 0.06677559018135071,
      "pose_rmse_dy": 0.08765222132205963,
      "pose_rmse_mean": 0.10071896016597748,
      "rmse_dtheta": 0.02101099118590355,
      "rmse_dx": 0.006431522313505411,
      "rmse_dy": 0.006484536919742823,
      "rmse_mean": 0.01130901649594307,
      "rotation_flip": 0.004312203731387854,
      "sparse_tokens": 32057.0,
      "step": 1223,
      "turn_loss": 0.06928715854883194,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.056866753391562906,
      "grad_norm": 0.6885921955108643,
      "learning_rate": 9.788808404197867e-06,
      "loss": 0.1564,
      "mae_dtheta": 0.010524630546569824,
      "mae_dx": 0.0016965417889878154,
      "mae_dy": 0.001617599162273109,
      "pose_mae_dtheta": 0.07655797898769379,
      "pose_mae_dx": 0.01803235337138176,
      "pose_mae_dy": 0.025208575651049614,
      "pose_rmse_dtheta": 0.2101542055606842,
      "pose_rmse_dx": 0.04880135878920555,
      "pose_rmse_dy": 0.07398443669080734,
      "pose_rmse_mean": 0.11098000407218933,
      "rmse_dtheta": 0.02481137216091156,
      "rmse_dx": 0.005410046316683292,
      "rmse_dy": 0.0036372279282659292,
      "rmse_mean": 0.011286215856671333,
      "rotation_flip": 0.0028721876442432404,
      "sparse_tokens": 32137.0,
      "step": 1224,
      "turn_loss": 0.0715329721570015,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.05691321315740569,
      "grad_norm": 0.5629867911338806,
      "learning_rate": 9.788428015268027e-06,
      "loss": 0.1383,
      "mae_dtheta": 0.03792046383023262,
      "mae_dx": 0.012774396687746048,
      "mae_dy": 0.0037440818268805742,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5629868507385254,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.5069580078125,
      "model/head/act_norm_mean": 100.49004961993244,
      "model/head/act_norm_min": 72.60333251953125,
      "model/head/act_over_embed": 69.0577029014847,
      "model/head/grad_frac": 0.10140310972929001,
      "model/head/grad_norm": 0.057088617235422134,
      "model/head/grad_zero_frac": 0.00016815404524095356,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6755437077702703,
      "model/head/update_ratio": 0.0009945272468030453,
      "model/head/weight_delta": 3.9067018032073975,
      "model/head/weight_delta_rel": 0.06853511929512024,
      "model/head/weight_norm": 57.402767181396484,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41217175126075745,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41217175126075745,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41217175126075745,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2832482862791244,
      "model/modality_embedder.encoders.pose/grad_frac": 0.094530388712883,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05321936681866646,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017333501018583775,
      "model/modality_embedder.encoders.pose/weight_delta": 1.2372511625289917,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.040424853563308716,
      "model/modality_embedder.encoders.pose/weight_norm": 30.703184127807617,
      "model/modality_embedder/grad_frac": 0.094530388712883,
      "model/modality_embedder/grad_norm": 0.05321936681866646,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0017333501018583775,
      "model/modality_embedder/weight_delta": 1.2372511625289917,
      "model/modality_embedder/weight_delta_rel": 0.040424853563308716,
      "model/modality_embedder/weight_norm": 30.703184127807617,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.57379913330078,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.452404413341913,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.206506729125977,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.429502515570478,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05936569347977638,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03342210501432419,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001213690615259111,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.6667171120643616,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.02429557405412197,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.537582397460938,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.27900695800781,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.375792645323894,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.701011657714844,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.064063553485326,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.062283240258693695,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03506464511156082,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012071371311321855,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.8187253475189209,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.028361285105347633,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.047771453857422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.1209487915039,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.069844956563706,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.19484806060791,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.22823216173694,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07542336732149124,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.042462363839149475,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014166627079248428,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.8609287738800049,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.028908375650644302,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.9735164642334,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 80.17809295654297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.010404936186188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.9010009765625,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.56180314754228,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0907701849937439,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.051102422177791595,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017381387297064066,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.7322895526885986,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.02502618171274662,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.400657653808594,
      "model/normalizer/grad_frac": 0.30010756850242615,
      "model/normalizer/grad_norm": 0.16895662248134613,
      "model/normalizer/grad_zero_frac": 0.0001772607647581026,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002170443069189787,
      "model/normalizer/weight_delta": 1.5854202508926392,
      "model/normalizer/weight_delta_rel": 0.020419294014573097,
      "model/normalizer/weight_norm": 77.84429931640625,
      "pose_mae_dtheta": 0.31823262572288513,
      "pose_mae_dx": 0.08420586585998535,
      "pose_mae_dy": 0.04370398074388504,
      "pose_rmse_dtheta": 0.5688342452049255,
      "pose_rmse_dx": 0.18745431303977966,
      "pose_rmse_dy": 0.1200239285826683,
      "pose_rmse_mean": 0.29210415482521057,
      "rmse_dtheta": 0.05663903430104256,
      "rmse_dx": 0.02469620481133461,
      "rmse_dy": 0.007726339623332024,
      "rmse_mean": 0.029687194153666496,
      "rotation_flip": 0.015437392517924309,
      "sparse_tokens": 9596.0,
      "step": 1225,
      "turn_loss": 0.24470213055610657,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.05695967292324847,
      "grad_norm": 0.46089795231819153,
      "learning_rate": 9.788047291480846e-06,
      "loss": 0.0964,
      "mae_dtheta": 0.010497885756194592,
      "mae_dx": 0.001894087065011263,
      "mae_dy": 0.002169904764741659,
      "pose_mae_dtheta": 0.07451007515192032,
      "pose_mae_dx": 0.02284378930926323,
      "pose_mae_dy": 0.030783729627728462,
      "pose_rmse_dtheta": 0.14932949841022491,
      "pose_rmse_dx": 0.05811019614338875,
      "pose_rmse_dy": 0.06973590701818466,
      "pose_rmse_mean": 0.09239187091588974,
      "rmse_dtheta": 0.02042791061103344,
      "rmse_dx": 0.006287377327680588,
      "rmse_dy": 0.004437039140611887,
      "rmse_mean": 0.010384108871221542,
      "rotation_flip": 0.003916960209608078,
      "sparse_tokens": 32073.0,
      "step": 1226,
      "turn_loss": 0.0818001851439476,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.05700613268909125,
      "grad_norm": 0.6486157178878784,
      "learning_rate": 9.787666232862949e-06,
      "loss": 0.1272,
      "mae_dtheta": 0.014042596332728863,
      "mae_dx": 0.004150277003645897,
      "mae_dy": 0.0038725859485566616,
      "pose_mae_dtheta": 0.10578590631484985,
      "pose_mae_dx": 0.05247259885072708,
      "pose_mae_dy": 0.042158618569374084,
      "pose_rmse_dtheta": 0.22972087562084198,
      "pose_rmse_dx": 0.1501367688179016,
      "pose_rmse_dy": 0.10199626535177231,
      "pose_rmse_mean": 0.16061797738075256,
      "rmse_dtheta": 0.027253810316324234,
      "rmse_dx": 0.011475740931928158,
      "rmse_dy": 0.009299525059759617,
      "rmse_mean": 0.01600969210267067,
      "rotation_flip": 0.004089050460606813,
      "sparse_tokens": 32057.0,
      "step": 1227,
      "turn_loss": 0.14049333333969116,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.05705259245493403,
      "grad_norm": 0.3284361958503723,
      "learning_rate": 9.787284839440982e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.009317206218838692,
      "mae_dx": 0.002093618270009756,
      "mae_dy": 0.0021849332842975855,
      "pose_mae_dtheta": 0.06883106380701065,
      "pose_mae_dx": 0.02347736805677414,
      "pose_mae_dy": 0.0289322417229414,
      "pose_rmse_dtheta": 0.14153946936130524,
      "pose_rmse_dx": 0.059242695569992065,
      "pose_rmse_dy": 0.06432805955410004,
      "pose_rmse_mean": 0.08837007731199265,
      "rmse_dtheta": 0.018753083422780037,
      "rmse_dx": 0.0059225894510746,
      "rmse_dy": 0.004447743762284517,
      "rmse_mean": 0.009707805700600147,
      "rotation_flip": 0.00372717110440135,
      "sparse_tokens": 32153.0,
      "step": 1228,
      "turn_loss": 0.07737819850444794,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.057099052220776804,
      "grad_norm": 0.7559834122657776,
      "learning_rate": 9.786903111241617e-06,
      "loss": 0.165,
      "mae_dtheta": 0.0478866845369339,
      "mae_dx": 0.017053378745913506,
      "mae_dy": 0.008036516606807709,
      "pose_mae_dtheta": 0.39348167181015015,
      "pose_mae_dx": 0.13767117261886597,
      "pose_mae_dy": 0.11103841662406921,
      "pose_rmse_dtheta": 0.6492766737937927,
      "pose_rmse_dx": 0.27627256512641907,
      "pose_rmse_dy": 0.24597497284412384,
      "pose_rmse_mean": 0.39050811529159546,
      "rmse_dtheta": 0.06592921167612076,
      "rmse_dx": 0.031233355402946472,
      "rmse_dy": 0.015062598511576653,
      "rmse_mean": 0.037408389151096344,
      "rotation_flip": 0.013665595091879368,
      "sparse_tokens": 20819.0,
      "step": 1229,
      "turn_loss": 0.36272746324539185,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05714551198661959,
      "grad_norm": 0.49354085326194763,
      "learning_rate": 9.786521048291548e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.011767410673201084,
      "mae_dx": 0.002936782781034708,
      "mae_dy": 0.004460534546524286,
      "pose_mae_dtheta": 0.08595240116119385,
      "pose_mae_dx": 0.04001392796635628,
      "pose_mae_dy": 0.04698401689529419,
      "pose_rmse_dtheta": 0.1832064390182495,
      "pose_rmse_dx": 0.11756406724452972,
      "pose_rmse_dy": 0.14089153707027435,
      "pose_rmse_mean": 0.1472207009792328,
      "rmse_dtheta": 0.02293381094932556,
      "rmse_dx": 0.0078103248961269855,
      "rmse_dy": 0.011138610541820526,
      "rmse_mean": 0.013960915617644787,
      "rotation_flip": 0.0029038111679255962,
      "sparse_tokens": 32089.0,
      "step": 1230,
      "turn_loss": 0.13283291459083557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.057191971752462364,
      "grad_norm": 0.3350600004196167,
      "learning_rate": 9.786138650617494e-06,
      "loss": 0.092,
      "mae_dtheta": 0.03161419555544853,
      "mae_dx": 0.00972281489521265,
      "mae_dy": 0.008948300033807755,
      "pose_mae_dtheta": 0.23423627018928528,
      "pose_mae_dx": 0.09746868908405304,
      "pose_mae_dy": 0.10860583931207657,
      "pose_rmse_dtheta": 0.34215009212493896,
      "pose_rmse_dx": 0.22218741476535797,
      "pose_rmse_dy": 0.22808077931404114,
      "pose_rmse_mean": 0.26413941383361816,
      "rmse_dtheta": 0.044203318655490875,
      "rmse_dx": 0.021803628653287888,
      "rmse_dy": 0.01747077703475952,
      "rmse_mean": 0.02782590687274933,
      "rotation_flip": 0.019130434840917587,
      "sparse_tokens": 9906.0,
      "step": 1231,
      "turn_loss": 0.29434895515441895,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.05723843151830515,
      "grad_norm": 1.1675188541412354,
      "learning_rate": 9.785755918246194e-06,
      "loss": 0.3034,
      "mae_dtheta": 0.04063471779227257,
      "mae_dx": 0.008391148410737514,
      "mae_dy": 0.007644545286893845,
      "pose_mae_dtheta": 0.32051247358322144,
      "pose_mae_dx": 0.07151108235120773,
      "pose_mae_dy": 0.09947007149457932,
      "pose_rmse_dtheta": 0.5830190777778625,
      "pose_rmse_dx": 0.17142049968242645,
      "pose_rmse_dy": 0.22968687117099762,
      "pose_rmse_mean": 0.3280421495437622,
      "rmse_dtheta": 0.05943276733160019,
      "rmse_dx": 0.019041860476136208,
      "rmse_dy": 0.015836812555789948,
      "rmse_mean": 0.03143714740872383,
      "rotation_flip": 0.014765100553631783,
      "sparse_tokens": 13065.0,
      "step": 1232,
      "turn_loss": 0.24732349812984467,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 18183.0,
      "epoch": 0.057284891284147925,
      "grad_norm": 0.6454063653945923,
      "learning_rate": 9.785372851204415e-06,
      "loss": 0.1513,
      "mae_dtheta": 0.03536079078912735,
      "mae_dx": 0.011695623397827148,
      "mae_dy": 0.007247909437865019,
      "pose_mae_dtheta": 0.2691420912742615,
      "pose_mae_dx": 0.10055823624134064,
      "pose_mae_dy": 0.08090677112340927,
      "pose_rmse_dtheta": 0.485722154378891,
      "pose_rmse_dx": 0.21394194662570953,
      "pose_rmse_dy": 0.19949454069137573,
      "pose_rmse_mean": 0.29971957206726074,
      "rmse_dtheta": 0.052881352603435516,
      "rmse_dx": 0.023361599072813988,
      "rmse_dy": 0.014870134182274342,
      "rmse_mean": 0.030371030792593956,
      "rotation_flip": 0.01427003275603056,
      "sparse_tokens": 13864.0,
      "step": 1233,
      "turn_loss": 0.25983551144599915,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.05733135104999071,
      "grad_norm": 1.00918710231781,
      "learning_rate": 9.784989449518944e-06,
      "loss": 0.2807,
      "mae_dtheta": 0.0500473715364933,
      "mae_dx": 0.01063251681625843,
      "mae_dy": 0.0070603895001113415,
      "pose_mae_dtheta": 0.4184532165527344,
      "pose_mae_dx": 0.09559603035449982,
      "pose_mae_dy": 0.09045111387968063,
      "pose_rmse_dtheta": 0.6805279850959778,
      "pose_rmse_dx": 0.19378845393657684,
      "pose_rmse_dy": 0.18197132647037506,
      "pose_rmse_mean": 0.35209593176841736,
      "rmse_dtheta": 0.0718131959438324,
      "rmse_dx": 0.02133982442319393,
      "rmse_dy": 0.01290026493370533,
      "rmse_mean": 0.03535109758377075,
      "rotation_flip": 0.022580645978450775,
      "sparse_tokens": 4960.0,
      "step": 1234,
      "turn_loss": 0.32599660754203796,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 11705.0,
      "epoch": 0.057377810815833485,
      "grad_norm": 0.897949755191803,
      "learning_rate": 9.784605713216592e-06,
      "loss": 0.3241,
      "mae_dtheta": 0.03188801184296608,
      "mae_dx": 0.007694616448134184,
      "mae_dy": 0.004133652430027723,
      "pose_mae_dtheta": 0.2355523556470871,
      "pose_mae_dx": 0.063481904566288,
      "pose_mae_dy": 0.0330624058842659,
      "pose_rmse_dtheta": 0.42372992634773254,
      "pose_rmse_dx": 0.13470898568630219,
      "pose_rmse_dy": 0.07401292771100998,
      "pose_rmse_mean": 0.21081727743148804,
      "rmse_dtheta": 0.048851367086172104,
      "rmse_dx": 0.017161967232823372,
      "rmse_dy": 0.008945252746343613,
      "rmse_mean": 0.02498619817197323,
      "rotation_flip": 0.016181230545043945,
      "sparse_tokens": 9364.0,
      "step": 1235,
      "turn_loss": 0.2486599236726761,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05742427058167627,
      "grad_norm": 0.4530864357948303,
      "learning_rate": 9.784221642324194e-06,
      "loss": 0.1624,
      "mae_dtheta": 0.014286979101598263,
      "mae_dx": 0.002390700625255704,
      "mae_dy": 0.0031369745265692472,
      "pose_mae_dtheta": 0.10379677265882492,
      "pose_mae_dx": 0.03271263837814331,
      "pose_mae_dy": 0.03835637867450714,
      "pose_rmse_dtheta": 0.23910386860370636,
      "pose_rmse_dx": 0.09099867194890976,
      "pose_rmse_dy": 0.10587161779403687,
      "pose_rmse_mean": 0.1453247219324112,
      "rmse_dtheta": 0.028272336348891258,
      "rmse_dx": 0.00740849832072854,
      "rmse_dy": 0.007122166454792023,
      "rmse_mean": 0.014267667196691036,
      "rotation_flip": 0.005651846062391996,
      "sparse_tokens": 32089.0,
      "step": 1236,
      "turn_loss": 0.10522333532571793,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.057470730347519046,
      "grad_norm": 0.6697632670402527,
      "learning_rate": 9.78383723686861e-06,
      "loss": 0.1804,
      "mae_dtheta": 0.038690630346536636,
      "mae_dx": 0.013268492184579372,
      "mae_dy": 0.004428389016538858,
      "pose_mae_dtheta": 0.3604901134967804,
      "pose_mae_dx": 0.10151243209838867,
      "pose_mae_dy": 0.04763438180088997,
      "pose_rmse_dtheta": 0.626036524772644,
      "pose_rmse_dx": 0.21831685304641724,
      "pose_rmse_dy": 0.11232893913984299,
      "pose_rmse_mean": 0.3188941180706024,
      "rmse_dtheta": 0.059879232197999954,
      "rmse_dx": 0.02545686438679695,
      "rmse_dy": 0.00861920416355133,
      "rmse_mean": 0.031318433582782745,
      "rotation_flip": 0.011627906933426857,
      "sparse_tokens": 4837.0,
      "step": 1237,
      "turn_loss": 0.3318621516227722,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.05751719011336183,
      "grad_norm": 0.4655997157096863,
      "learning_rate": 9.783452496876719e-06,
      "loss": 0.1352,
      "mae_dtheta": 0.02923622541129589,
      "mae_dx": 0.008553162217140198,
      "mae_dy": 0.005055352114140987,
      "pose_mae_dtheta": 0.23570092022418976,
      "pose_mae_dx": 0.07382029294967651,
      "pose_mae_dy": 0.07614900171756744,
      "pose_rmse_dtheta": 0.3752273917198181,
      "pose_rmse_dx": 0.17386050522327423,
      "pose_rmse_dy": 0.18247443437576294,
      "pose_rmse_mean": 0.2438541054725647,
      "rmse_dtheta": 0.04325152933597565,
      "rmse_dx": 0.02009018510580063,
      "rmse_dy": 0.009463686496019363,
      "rmse_mean": 0.024268468841910362,
      "rotation_flip": 0.012480499222874641,
      "sparse_tokens": 13299.0,
      "step": 1238,
      "turn_loss": 0.24332618713378906,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.057563649879204606,
      "grad_norm": 0.42466169595718384,
      "learning_rate": 9.783067422375428e-06,
      "loss": 0.0931,
      "mae_dtheta": 0.01344794686883688,
      "mae_dx": 0.0021157602313905954,
      "mae_dy": 0.0029536550864577293,
      "pose_mae_dtheta": 0.09076867997646332,
      "pose_mae_dx": 0.024661226198077202,
      "pose_mae_dy": 0.03878994286060333,
      "pose_rmse_dtheta": 0.2057427614927292,
      "pose_rmse_dx": 0.06836611032485962,
      "pose_rmse_dy": 0.10268262773752213,
      "pose_rmse_mean": 0.12559717893600464,
      "rmse_dtheta": 0.026912786066532135,
      "rmse_dx": 0.007040902506560087,
      "rmse_dy": 0.007115787826478481,
      "rmse_mean": 0.013689826242625713,
      "rotation_flip": 0.0041841003112494946,
      "sparse_tokens": 32073.0,
      "step": 1239,
      "turn_loss": 0.09130378812551498,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.05761010964504739,
      "grad_norm": 0.6399586796760559,
      "learning_rate": 9.782682013391665e-06,
      "loss": 0.1616,
      "mae_dtheta": 0.029330221936106682,
      "mae_dx": 0.013908621855080128,
      "mae_dy": 0.0058155483566224575,
      "pose_mae_dtheta": 0.22567720711231232,
      "pose_mae_dx": 0.1107272282242775,
      "pose_mae_dy": 0.06675358861684799,
      "pose_rmse_dtheta": 0.4169287085533142,
      "pose_rmse_dx": 0.20804589986801147,
      "pose_rmse_dy": 0.1483551561832428,
      "pose_rmse_mean": 0.2577765882015228,
      "rmse_dtheta": 0.04677821695804596,
      "rmse_dx": 0.02601969987154007,
      "rmse_dy": 0.011591112241148949,
      "rmse_mean": 0.02812967821955681,
      "rotation_flip": 0.01430274173617363,
      "sparse_tokens": 14547.0,
      "step": 1240,
      "turn_loss": 0.31164565682411194,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.05765656941089017,
      "grad_norm": 0.46268022060394287,
      "learning_rate": 9.78229626995238e-06,
      "loss": 0.1299,
      "mae_dtheta": 0.03844369575381279,
      "mae_dx": 0.016479212790727615,
      "mae_dy": 0.004322740249335766,
      "pose_mae_dtheta": 0.3304786682128906,
      "pose_mae_dx": 0.13389654457569122,
      "pose_mae_dy": 0.061622072011232376,
      "pose_rmse_dtheta": 0.5462574362754822,
      "pose_rmse_dx": 0.27959421277046204,
      "pose_rmse_dy": 0.14351363480091095,
      "pose_rmse_mean": 0.3231217861175537,
      "rmse_dtheta": 0.05647916719317436,
      "rmse_dx": 0.02949403040111065,
      "rmse_dy": 0.008571060374379158,
      "rmse_mean": 0.03151475265622139,
      "rotation_flip": 0.008652657270431519,
      "sparse_tokens": 14724.0,
      "step": 1241,
      "turn_loss": 0.3772451877593994,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.05770302917673295,
      "grad_norm": 0.46629810333251953,
      "learning_rate": 9.781910192084553e-06,
      "loss": 0.0943,
      "mae_dtheta": 0.026984792202711105,
      "mae_dx": 0.016027720645070076,
      "mae_dy": 0.004425783175975084,
      "pose_mae_dtheta": 0.22194424271583557,
      "pose_mae_dx": 0.12188410013914108,
      "pose_mae_dy": 0.07639986276626587,
      "pose_rmse_dtheta": 0.3680315315723419,
      "pose_rmse_dx": 0.25302228331565857,
      "pose_rmse_dy": 0.1916772574186325,
      "pose_rmse_mean": 0.270910382270813,
      "rmse_dtheta": 0.039041344076395035,
      "rmse_dx": 0.028559649363160133,
      "rmse_dy": 0.00816800445318222,
      "rmse_mean": 0.025256333872675896,
      "rotation_flip": 0.003322259057313204,
      "sparse_tokens": 5505.0,
      "step": 1242,
      "turn_loss": 0.22904755175113678,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.05774948894257573,
      "grad_norm": 0.4599453806877136,
      "learning_rate": 9.781523779815178e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.03641064465045929,
      "mae_dx": 0.012137689627707005,
      "mae_dy": 0.007549275644123554,
      "pose_mae_dtheta": 0.2836533188819885,
      "pose_mae_dx": 0.0911424532532692,
      "pose_mae_dy": 0.11748415231704712,
      "pose_rmse_dtheta": 0.4762727618217468,
      "pose_rmse_dx": 0.18826131522655487,
      "pose_rmse_dy": 0.23159557580947876,
      "pose_rmse_mean": 0.298709899187088,
      "rmse_dtheta": 0.052323855459690094,
      "rmse_dx": 0.024502838030457497,
      "rmse_dy": 0.011830760166049004,
      "rmse_mean": 0.029552485793828964,
      "rotation_flip": 0.01247771829366684,
      "sparse_tokens": 9390.0,
      "step": 1243,
      "turn_loss": 0.30665022134780884,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.05779594870841851,
      "grad_norm": 0.6136474609375,
      "learning_rate": 9.781137033171279e-06,
      "loss": 0.1965,
      "mae_dtheta": 0.015055728144943714,
      "mae_dx": 0.0028443532064557076,
      "mae_dy": 0.002960901940241456,
      "pose_mae_dtheta": 0.10594566911458969,
      "pose_mae_dx": 0.03274117782711983,
      "pose_mae_dy": 0.037244074046611786,
      "pose_rmse_dtheta": 0.24499405920505524,
      "pose_rmse_dx": 0.07087010890245438,
      "pose_rmse_dy": 0.08309783786535263,
      "pose_rmse_mean": 0.1329873502254486,
      "rmse_dtheta": 0.030672773718833923,
      "rmse_dx": 0.008609297685325146,
      "rmse_dy": 0.007135922089219093,
      "rmse_mean": 0.015472665429115295,
      "rotation_flip": 0.00766143761575222,
      "sparse_tokens": 32137.0,
      "step": 1244,
      "turn_loss": 0.13740919530391693,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33637.0,
      "epoch": 0.05784240847426129,
      "grad_norm": 0.6977535486221313,
      "learning_rate": 9.780749952179902e-06,
      "loss": 0.2459,
      "mae_dtheta": 0.03586442396044731,
      "mae_dx": 0.00997492391616106,
      "mae_dy": 0.004041227977722883,
      "pose_mae_dtheta": 0.2779742479324341,
      "pose_mae_dx": 0.07702094316482544,
      "pose_mae_dy": 0.05015549063682556,
      "pose_rmse_dtheta": 0.5129379630088806,
      "pose_rmse_dx": 0.17271822690963745,
      "pose_rmse_dy": 0.1306370198726654,
      "pose_rmse_mean": 0.27209776639938354,
      "rmse_dtheta": 0.055405329912900925,
      "rmse_dx": 0.02070125751197338,
      "rmse_dy": 0.00957786850631237,
      "rmse_mean": 0.028561485931277275,
      "rotation_flip": 0.011053794994950294,
      "sparse_tokens": 26627.0,
      "step": 1245,
      "turn_loss": 0.23932300508022308,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.05788886824010407,
      "grad_norm": 0.6966698169708252,
      "learning_rate": 9.780362536868113e-06,
      "loss": 0.101,
      "mae_dtheta": 0.008669020608067513,
      "mae_dx": 0.0011928207240998745,
      "mae_dy": 0.001754201715812087,
      "pose_mae_dtheta": 0.05662060156464577,
      "pose_mae_dx": 0.016291934996843338,
      "pose_mae_dy": 0.027127504348754883,
      "pose_rmse_dtheta": 0.10708949714899063,
      "pose_rmse_dx": 0.04001767188310623,
      "pose_rmse_dy": 0.06302648782730103,
      "pose_rmse_mean": 0.07004455476999283,
      "rmse_dtheta": 0.017016444355249405,
      "rmse_dx": 0.003931242972612381,
      "rmse_dy": 0.003269363194704056,
      "rmse_mean": 0.008072350174188614,
      "rotation_flip": 0.004698512144386768,
      "sparse_tokens": 32073.0,
      "step": 1246,
      "turn_loss": 0.07122529298067093,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 41863.0,
      "epoch": 0.05793532800594685,
      "grad_norm": 0.6673122644424438,
      "learning_rate": 9.779974787263008e-06,
      "loss": 0.1778,
      "mae_dtheta": 0.03408990427851677,
      "mae_dx": 0.014213464222848415,
      "mae_dy": 0.004916979931294918,
      "pose_mae_dtheta": 0.27366161346435547,
      "pose_mae_dx": 0.11219532042741776,
      "pose_mae_dy": 0.05895472690463066,
      "pose_rmse_dtheta": 0.47656193375587463,
      "pose_rmse_dx": 0.24332191050052643,
      "pose_rmse_dy": 0.1355481594800949,
      "pose_rmse_mean": 0.28514403104782104,
      "rmse_dtheta": 0.05067715793848038,
      "rmse_dx": 0.027190163731575012,
      "rmse_dy": 0.010965436697006226,
      "rmse_mean": 0.029610920697450638,
      "rotation_flip": 0.013921113684773445,
      "sparse_tokens": 30163.0,
      "step": 1247,
      "turn_loss": 0.3153790533542633,
      "turns": 129.0,
      "turns_per_sample": 129.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.05798178777178963,
      "grad_norm": 0.4596826434135437,
      "learning_rate": 9.7795867033917e-06,
      "loss": 0.1521,
      "mae_dtheta": 0.010113855823874474,
      "mae_dx": 0.0017740080365911126,
      "mae_dy": 0.002365858294069767,
      "pose_mae_dtheta": 0.06860089302062988,
      "pose_mae_dx": 0.024456173181533813,
      "pose_mae_dy": 0.0290919728577137,
      "pose_rmse_dtheta": 0.14403189718723297,
      "pose_rmse_dx": 0.061162300407886505,
      "pose_rmse_dy": 0.06396611779928207,
      "pose_rmse_mean": 0.08972011506557465,
      "rmse_dtheta": 0.020255912095308304,
      "rmse_dx": 0.005393470171838999,
      "rmse_dy": 0.005179154220968485,
      "rmse_mean": 0.01027617882937193,
      "rotation_flip": 0.0028901733458042145,
      "sparse_tokens": 32073.0,
      "step": 1248,
      "turn_loss": 0.07479840517044067,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.05802824753763241,
      "grad_norm": 0.6684710383415222,
      "learning_rate": 9.779198285281326e-06,
      "loss": 0.2335,
      "mae_dtheta": 0.02881217934191227,
      "mae_dx": 0.009978663176298141,
      "mae_dy": 0.00526416813954711,
      "pose_mae_dtheta": 0.21946632862091064,
      "pose_mae_dx": 0.07091361284255981,
      "pose_mae_dy": 0.04171743243932724,
      "pose_rmse_dtheta": 0.39562973380088806,
      "pose_rmse_dx": 0.15246377885341644,
      "pose_rmse_dy": 0.08288734406232834,
      "pose_rmse_mean": 0.21032695472240448,
      "rmse_dtheta": 0.045585330575704575,
      "rmse_dx": 0.020555289462208748,
      "rmse_dy": 0.009798933751881123,
      "rmse_mean": 0.025313187390565872,
      "rotation_flip": 0.022082019597291946,
      "sparse_tokens": 6508.0,
      "step": 1249,
      "turn_loss": 0.23930083215236664,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.05807470730347519,
      "grad_norm": 0.49348270893096924,
      "learning_rate": 9.778809532959053e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.01154240220785141,
      "mae_dx": 0.002181555377319455,
      "mae_dy": 0.0026540467515587807,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.49348264932632446,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.70599365234375,
      "model/head/act_norm_mean": 112.80463817866162,
      "model/head/act_norm_min": 66.9107666015625,
      "model/head/act_over_embed": 77.52040345003792,
      "model/head/grad_frac": 0.09822782129049301,
      "model/head/grad_norm": 0.04847372695803642,
      "model/head/grad_zero_frac": 0.0001792585535440594,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6803434738005051,
      "model/head/update_ratio": 0.0008443216211162508,
      "model/head/weight_delta": 3.95737886428833,
      "model/head/weight_delta_rel": 0.06942414492368698,
      "model/head/weight_norm": 57.41144943237305,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4122558832168579,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4121847360935794,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41210395097732544,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2832572095778056,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09239871054887772,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04559716209769249,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5397959879912664,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014849912840873003,
      "model/modality_embedder.encoders.pose/weight_delta": 1.2552953958511353,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.041014414280653,
      "model/modality_embedder.encoders.pose/weight_norm": 30.705339431762695,
      "model/modality_embedder/grad_frac": 0.09239871054887772,
      "model/modality_embedder/grad_norm": 0.04559716209769249,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5397959879912664,
      "model/modality_embedder/update_ratio": 0.0014849912840873003,
      "model/modality_embedder/weight_delta": 1.2552953958511353,
      "model/modality_embedder/weight_delta_rel": 0.041014414280653,
      "model/modality_embedder/weight_norm": 30.705339431762695,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.28289031982422,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.645071749238415,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.004094123840332,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.249114674726076,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06834401190280914,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.033726584166288376,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012246434343978763,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.6787927746772766,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.024735618382692337,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.539920806884766,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.62677001953125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.749529020362353,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.29419231414795,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.00810805153433,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07600345462560654,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03750638663768768,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012910510413348675,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.8337839245796204,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.02888292632997036,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.051048278808594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.48021697998047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.73563011063011,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.691657066345215,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.372975314937694,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0933222621679306,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04605291783809662,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015362818958237767,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.8772724866867065,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.02945716679096222,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.97686767578125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.23112487792969,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.60216750841751,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.663147926330566,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.65567728949563,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1278398633003235,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06308675557374954,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0021454542875289917,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.7469631433486938,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.025527656078338623,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.40484619140625,
      "model/normalizer/grad_frac": 0.5012606382369995,
      "model/normalizer/grad_norm": 0.24736341834068298,
      "model/normalizer/grad_zero_frac": 0.00016307989426422864,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0031774987000972033,
      "model/normalizer/weight_delta": 1.6153565645217896,
      "model/normalizer/weight_delta_rel": 0.020804857835173607,
      "model/normalizer/weight_norm": 77.84847259521484,
      "pose_mae_dtheta": 0.0848383903503418,
      "pose_mae_dx": 0.024045182392001152,
      "pose_mae_dy": 0.03317509591579437,
      "pose_rmse_dtheta": 0.18570344150066376,
      "pose_rmse_dx": 0.06267448514699936,
      "pose_rmse_dy": 0.08097559958696365,
      "pose_rmse_mean": 0.10978450626134872,
      "rmse_dtheta": 0.023519471287727356,
      "rmse_dx": 0.0062818522565066814,
      "rmse_dy": 0.00591772748157382,
      "rmse_mean": 0.011906350962817669,
      "rotation_flip": 0.002889129566028714,
      "sparse_tokens": 32153.0,
      "step": 1250,
      "turn_loss": 0.08165892958641052,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.05812116706931797,
      "grad_norm": 0.44408175349235535,
      "learning_rate": 9.778420446452063e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.015147631987929344,
      "mae_dx": 0.0034691293258219957,
      "mae_dy": 0.0037146189715713263,
      "pose_mae_dtheta": 0.11516599357128143,
      "pose_mae_dx": 0.03212127462029457,
      "pose_mae_dy": 0.03584687039256096,
      "pose_rmse_dtheta": 0.2742811143398285,
      "pose_rmse_dx": 0.07275402545928955,
      "pose_rmse_dy": 0.0940401554107666,
      "pose_rmse_mean": 0.14702510833740234,
      "rmse_dtheta": 0.031890466809272766,
      "rmse_dx": 0.009571838192641735,
      "rmse_dy": 0.00896366685628891,
      "rmse_mean": 0.016808658838272095,
      "rotation_flip": 0.007253886200487614,
      "sparse_tokens": 32169.0,
      "step": 1251,
      "turn_loss": 0.1416306346654892,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.05816762683516075,
      "grad_norm": 0.738260805606842,
      "learning_rate": 9.778031025787569e-06,
      "loss": 0.1831,
      "mae_dtheta": 0.031520869582891464,
      "mae_dx": 0.007268394343554974,
      "mae_dy": 0.0028940713964402676,
      "pose_mae_dtheta": 0.23098859190940857,
      "pose_mae_dx": 0.05024673044681549,
      "pose_mae_dy": 0.03308969363570213,
      "pose_rmse_dtheta": 0.3879152834415436,
      "pose_rmse_dx": 0.1121479794383049,
      "pose_rmse_dy": 0.08467549085617065,
      "pose_rmse_mean": 0.19491291046142578,
      "rmse_dtheta": 0.04870174825191498,
      "rmse_dx": 0.01600005477666855,
      "rmse_dy": 0.005964523646980524,
      "rmse_mean": 0.023555442690849304,
      "rotation_flip": 0.006644518114626408,
      "sparse_tokens": 5503.0,
      "step": 1252,
      "turn_loss": 0.20807981491088867,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.05821408660100353,
      "grad_norm": 0.7117383480072021,
      "learning_rate": 9.777641270992799e-06,
      "loss": 0.1426,
      "mae_dtheta": 0.012513762339949608,
      "mae_dx": 0.0027628587558865547,
      "mae_dy": 0.0027745026163756847,
      "pose_mae_dtheta": 0.09611992537975311,
      "pose_mae_dx": 0.022893864661455154,
      "pose_mae_dy": 0.03478223830461502,
      "pose_rmse_dtheta": 0.22619955241680145,
      "pose_rmse_dx": 0.051970914006233215,
      "pose_rmse_dy": 0.07509967684745789,
      "pose_rmse_mean": 0.11775671690702438,
      "rmse_dtheta": 0.0262774471193552,
      "rmse_dx": 0.00860591046512127,
      "rmse_dy": 0.006508149206638336,
      "rmse_mean": 0.013797169551253319,
      "rotation_flip": 0.005947955418378115,
      "sparse_tokens": 32105.0,
      "step": 1253,
      "turn_loss": 0.1211462989449501,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.058260546366846314,
      "grad_norm": 0.5088813304901123,
      "learning_rate": 9.77725118209501e-06,
      "loss": 0.1102,
      "mae_dtheta": 0.010053111240267754,
      "mae_dx": 0.002122193807736039,
      "mae_dy": 0.000989663996733725,
      "pose_mae_dtheta": 0.0796729177236557,
      "pose_mae_dx": 0.021564513444900513,
      "pose_mae_dy": 0.01353476569056511,
      "pose_rmse_dtheta": 0.27878570556640625,
      "pose_rmse_dx": 0.058062631636857986,
      "pose_rmse_dy": 0.043849315494298935,
      "pose_rmse_mean": 0.12689922749996185,
      "rmse_dtheta": 0.03053165227174759,
      "rmse_dx": 0.005911761894822121,
      "rmse_dy": 0.0029964083805680275,
      "rmse_mean": 0.013146607205271721,
      "rotation_flip": 0.0031628888100385666,
      "sparse_tokens": 32201.0,
      "step": 1254,
      "turn_loss": 0.06468084454536438,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.05830700613268909,
      "grad_norm": 0.45317310094833374,
      "learning_rate": 9.776860759121485e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.024751147255301476,
      "mae_dx": 0.009456762112677097,
      "mae_dy": 0.004029932897537947,
      "pose_mae_dtheta": 0.19997689127922058,
      "pose_mae_dx": 0.07029207795858383,
      "pose_mae_dy": 0.042882442474365234,
      "pose_rmse_dtheta": 0.34485912322998047,
      "pose_rmse_dx": 0.16971027851104736,
      "pose_rmse_dy": 0.0937889888882637,
      "pose_rmse_mean": 0.2027861326932907,
      "rmse_dtheta": 0.03923839330673218,
      "rmse_dx": 0.02099301852285862,
      "rmse_dy": 0.006918397266417742,
      "rmse_mean": 0.022383270785212517,
      "rotation_flip": 0.007736944127827883,
      "sparse_tokens": 9390.0,
      "step": 1255,
      "turn_loss": 0.2146168053150177,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.058353465898531874,
      "grad_norm": 0.6545340418815613,
      "learning_rate": 9.77647000209952e-06,
      "loss": 0.1361,
      "mae_dtheta": 0.01225225068628788,
      "mae_dx": 0.0028670872561633587,
      "mae_dy": 0.003884386271238327,
      "pose_mae_dtheta": 0.0941416472196579,
      "pose_mae_dx": 0.03466581553220749,
      "pose_mae_dy": 0.0449836403131485,
      "pose_rmse_dtheta": 0.2043280303478241,
      "pose_rmse_dx": 0.10402099043130875,
      "pose_rmse_dy": 0.10829384624958038,
      "pose_rmse_mean": 0.13888095319271088,
      "rmse_dtheta": 0.023844381794333458,
      "rmse_dx": 0.009080532938241959,
      "rmse_dy": 0.009378856047987938,
      "rmse_mean": 0.014101257547736168,
      "rotation_flip": 0.005289006512612104,
      "sparse_tokens": 32041.0,
      "step": 1256,
      "turn_loss": 0.11639194190502167,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.05839992566437465,
      "grad_norm": 0.3641333281993866,
      "learning_rate": 9.776078911056445e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.04023531451821327,
      "mae_dx": 0.01489180326461792,
      "mae_dy": 0.0021984493359923363,
      "pose_mae_dtheta": 0.3295915722846985,
      "pose_mae_dx": 0.10481373965740204,
      "pose_mae_dy": 0.027832230553030968,
      "pose_rmse_dtheta": 0.5754109025001526,
      "pose_rmse_dx": 0.24799233675003052,
      "pose_rmse_dy": 0.0747552290558815,
      "pose_rmse_mean": 0.2993861734867096,
      "rmse_dtheta": 0.059504155069589615,
      "rmse_dx": 0.028446340933442116,
      "rmse_dy": 0.004427695646882057,
      "rmse_mean": 0.030792731791734695,
      "rotation_flip": 0.016166280955076218,
      "sparse_tokens": 7426.0,
      "step": 1257,
      "turn_loss": 0.2744375169277191,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.058446385430217435,
      "grad_norm": 0.5172344446182251,
      "learning_rate": 9.775687486019609e-06,
      "loss": 0.153,
      "mae_dtheta": 0.008376211859285831,
      "mae_dx": 0.0014551908243447542,
      "mae_dy": 0.002031866228207946,
      "pose_mae_dtheta": 0.05976864695549011,
      "pose_mae_dx": 0.016789305955171585,
      "pose_mae_dy": 0.02880740351974964,
      "pose_rmse_dtheta": 0.12369179725646973,
      "pose_rmse_dx": 0.04559575766324997,
      "pose_rmse_dy": 0.07236827164888382,
      "pose_rmse_mean": 0.08055194467306137,
      "rmse_dtheta": 0.017507381737232208,
      "rmse_dx": 0.0048026880249381065,
      "rmse_dy": 0.006325508467853069,
      "rmse_mean": 0.00954519398510456,
      "rotation_flip": 0.007111597340553999,
      "sparse_tokens": 32057.0,
      "step": 1258,
      "turn_loss": 0.07956399768590927,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.05849284519606021,
      "grad_norm": 0.3679596781730652,
      "learning_rate": 9.775295727016382e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.006718131247907877,
      "mae_dx": 0.0013392787659540772,
      "mae_dy": 0.0007861214107833803,
      "pose_mae_dtheta": 0.04742351546883583,
      "pose_mae_dx": 0.015034149400889874,
      "pose_mae_dy": 0.014381793327629566,
      "pose_rmse_dtheta": 0.1761237531900406,
      "pose_rmse_dx": 0.04669058695435524,
      "pose_rmse_dy": 0.05145877227187157,
      "pose_rmse_mean": 0.0914243683218956,
      "rmse_dtheta": 0.021889083087444305,
      "rmse_dx": 0.00398680055513978,
      "rmse_dy": 0.002660504775121808,
      "rmse_mean": 0.009512130171060562,
      "rotation_flip": 0.00064184854272753,
      "sparse_tokens": 32105.0,
      "step": 1259,
      "turn_loss": 0.051184386014938354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.058539304961902995,
      "grad_norm": 0.652516782283783,
      "learning_rate": 9.774903634074163e-06,
      "loss": 0.1984,
      "mae_dtheta": 0.025928305462002754,
      "mae_dx": 0.008262107148766518,
      "mae_dy": 0.007988892495632172,
      "pose_mae_dtheta": 0.21920396387577057,
      "pose_mae_dx": 0.057512685656547546,
      "pose_mae_dy": 0.05720359832048416,
      "pose_rmse_dtheta": 0.5054323673248291,
      "pose_rmse_dx": 0.1466042697429657,
      "pose_rmse_dy": 0.15313458442687988,
      "pose_rmse_mean": 0.268390417098999,
      "rmse_dtheta": 0.05104025825858116,
      "rmse_dx": 0.01960442215204239,
      "rmse_dy": 0.021798554807901382,
      "rmse_mean": 0.030814409255981445,
      "rotation_flip": 0.012182014063000679,
      "sparse_tokens": 32217.0,
      "step": 1260,
      "turn_loss": 0.2616938650608063,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.05858576472774577,
      "grad_norm": 0.6799126863479614,
      "learning_rate": 9.774511207220369e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.03347711265087128,
      "mae_dx": 0.009297513402998447,
      "mae_dy": 0.004177379421889782,
      "pose_mae_dtheta": 0.28579360246658325,
      "pose_mae_dx": 0.07107336074113846,
      "pose_mae_dy": 0.04902103170752525,
      "pose_rmse_dtheta": 0.44922107458114624,
      "pose_rmse_dx": 0.15681691467761993,
      "pose_rmse_dy": 0.11644881218671799,
      "pose_rmse_mean": 0.24082893133163452,
      "rmse_dtheta": 0.049420908093452454,
      "rmse_dx": 0.01950090005993843,
      "rmse_dy": 0.00809606071561575,
      "rmse_mean": 0.02567262202501297,
      "rotation_flip": 0.015432098880410194,
      "sparse_tokens": 10372.0,
      "step": 1261,
      "turn_loss": 0.29463663697242737,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.058632224493588556,
      "grad_norm": 0.5886778235435486,
      "learning_rate": 9.774118446482445e-06,
      "loss": 0.12,
      "mae_dtheta": 0.008932591415941715,
      "mae_dx": 0.002349025569856167,
      "mae_dy": 0.0030761745292693377,
      "pose_mae_dtheta": 0.06750671565532684,
      "pose_mae_dx": 0.03130338340997696,
      "pose_mae_dy": 0.03518018499016762,
      "pose_rmse_dtheta": 0.1767285317182541,
      "pose_rmse_dx": 0.08844038844108582,
      "pose_rmse_dy": 0.09488363564014435,
      "pose_rmse_mean": 0.12001751363277435,
      "rmse_dtheta": 0.020655609667301178,
      "rmse_dx": 0.00708939740434289,
      "rmse_dy": 0.007754944264888763,
      "rmse_mean": 0.011833317577838898,
      "rotation_flip": 0.004556961823254824,
      "sparse_tokens": 32057.0,
      "step": 1262,
      "turn_loss": 0.07461588084697723,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05867868425943133,
      "grad_norm": 0.46711623668670654,
      "learning_rate": 9.773725351887857e-06,
      "loss": 0.088,
      "mae_dtheta": 0.009644486010074615,
      "mae_dx": 0.0022389194928109646,
      "mae_dy": 0.0020835697650909424,
      "pose_mae_dtheta": 0.06978122144937515,
      "pose_mae_dx": 0.025486493483185768,
      "pose_mae_dy": 0.02780274860560894,
      "pose_rmse_dtheta": 0.16780301928520203,
      "pose_rmse_dx": 0.0724712610244751,
      "pose_rmse_dy": 0.07225459069013596,
      "pose_rmse_mean": 0.10417629778385162,
      "rmse_dtheta": 0.020895887166261673,
      "rmse_dx": 0.0067553529515862465,
      "rmse_dy": 0.005113164894282818,
      "rmse_mean": 0.010921468958258629,
      "rotation_flip": 0.006698564626276493,
      "sparse_tokens": 32089.0,
      "step": 1263,
      "turn_loss": 0.07947373390197754,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.05872514402527411,
      "grad_norm": 0.6043477058410645,
      "learning_rate": 9.77333192346409e-06,
      "loss": 0.1753,
      "mae_dtheta": 0.02656615525484085,
      "mae_dx": 0.006313910707831383,
      "mae_dy": 0.0024687503464519978,
      "pose_mae_dtheta": 0.19296100735664368,
      "pose_mae_dx": 0.05142350122332573,
      "pose_mae_dy": 0.036131568253040314,
      "pose_rmse_dtheta": 0.40887072682380676,
      "pose_rmse_dx": 0.12797865271568298,
      "pose_rmse_dy": 0.10077168792486191,
      "pose_rmse_mean": 0.21254035830497742,
      "rmse_dtheta": 0.04788999259471893,
      "rmse_dx": 0.01603211835026741,
      "rmse_dy": 0.006505088414996862,
      "rmse_mean": 0.023475732654333115,
      "rotation_flip": 0.007092198356986046,
      "sparse_tokens": 20047.0,
      "step": 1264,
      "turn_loss": 0.1795450896024704,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05877160379111689,
      "grad_norm": 0.7866376638412476,
      "learning_rate": 9.77293816123866e-06,
      "loss": 0.139,
      "mae_dtheta": 0.013148232363164425,
      "mae_dx": 0.0025540816131979227,
      "mae_dy": 0.0039324150420725346,
      "pose_mae_dtheta": 0.09087605029344559,
      "pose_mae_dx": 0.037047069519758224,
      "pose_mae_dy": 0.04512074962258339,
      "pose_rmse_dtheta": 0.1957540363073349,
      "pose_rmse_dx": 0.09811923652887344,
      "pose_rmse_dy": 0.11054365336894989,
      "pose_rmse_mean": 0.13480564951896667,
      "rmse_dtheta": 0.024892497807741165,
      "rmse_dx": 0.007105034776031971,
      "rmse_dy": 0.00877826102077961,
      "rmse_mean": 0.013591930270195007,
      "rotation_flip": 0.006766917183995247,
      "sparse_tokens": 32089.0,
      "step": 1265,
      "turn_loss": 0.12492867559194565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.05881806355695967,
      "grad_norm": 0.8026474714279175,
      "learning_rate": 9.772544065239105e-06,
      "loss": 0.1029,
      "mae_dtheta": 0.010760851204395294,
      "mae_dx": 0.0026566809974610806,
      "mae_dy": 0.002346605993807316,
      "pose_mae_dtheta": 0.07671324908733368,
      "pose_mae_dx": 0.02909715101122856,
      "pose_mae_dy": 0.028319889679551125,
      "pose_rmse_dtheta": 0.20416933298110962,
      "pose_rmse_dx": 0.07910533994436264,
      "pose_rmse_dy": 0.0608663447201252,
      "pose_rmse_mean": 0.11471368372440338,
      "rmse_dtheta": 0.025527121499180794,
      "rmse_dx": 0.007767173461616039,
      "rmse_dy": 0.005669218488037586,
      "rmse_mean": 0.012987837195396423,
      "rotation_flip": 0.005037783179432154,
      "sparse_tokens": 32153.0,
      "step": 1266,
      "turn_loss": 0.07952877134084702,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.05886452332280245,
      "grad_norm": 0.8259629607200623,
      "learning_rate": 9.772149635492979e-06,
      "loss": 0.1857,
      "mae_dtheta": 0.013387594372034073,
      "mae_dx": 0.002353324554860592,
      "mae_dy": 0.002736190799623728,
      "pose_mae_dtheta": 0.09259894490242004,
      "pose_mae_dx": 0.025606917217373848,
      "pose_mae_dy": 0.034558169543743134,
      "pose_rmse_dtheta": 0.2197103053331375,
      "pose_rmse_dx": 0.06481777876615524,
      "pose_rmse_dy": 0.08877801895141602,
      "pose_rmse_mean": 0.12443536520004272,
      "rmse_dtheta": 0.026968909427523613,
      "rmse_dx": 0.007208393421024084,
      "rmse_dy": 0.006209587678313255,
      "rmse_mean": 0.01346229761838913,
      "rotation_flip": 0.004234026186168194,
      "sparse_tokens": 32089.0,
      "step": 1267,
      "turn_loss": 0.12879769504070282,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.05891098308864523,
      "grad_norm": 0.7333637475967407,
      "learning_rate": 9.771754872027869e-06,
      "loss": 0.1591,
      "mae_dtheta": 0.03627336397767067,
      "mae_dx": 0.015292166732251644,
      "mae_dy": 0.008268710225820541,
      "pose_mae_dtheta": 0.29773324728012085,
      "pose_mae_dx": 0.113590769469738,
      "pose_mae_dy": 0.12079620361328125,
      "pose_rmse_dtheta": 0.4620852768421173,
      "pose_rmse_dx": 0.2467380166053772,
      "pose_rmse_dy": 0.23066860437393188,
      "pose_rmse_mean": 0.31316399574279785,
      "rmse_dtheta": 0.04991922900080681,
      "rmse_dx": 0.028659198433160782,
      "rmse_dy": 0.012897449545562267,
      "rmse_mean": 0.030491959303617477,
      "rotation_flip": 0.011583011597394943,
      "sparse_tokens": 5306.0,
      "step": 1268,
      "turn_loss": 0.39183172583580017,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.058957442854488014,
      "grad_norm": 0.5961383581161499,
      "learning_rate": 9.771359774871379e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.009676944464445114,
      "mae_dx": 0.0017840267391875386,
      "mae_dy": 0.001838365918956697,
      "pose_mae_dtheta": 0.06305962800979614,
      "pose_mae_dx": 0.023584632202982903,
      "pose_mae_dy": 0.023566080257296562,
      "pose_rmse_dtheta": 0.1421135812997818,
      "pose_rmse_dx": 0.05931474268436432,
      "pose_rmse_dy": 0.06489227712154388,
      "pose_rmse_mean": 0.08877353370189667,
      "rmse_dtheta": 0.020875096321105957,
      "rmse_dx": 0.00521662924438715,
      "rmse_dy": 0.00405467813834548,
      "rmse_mean": 0.010048801079392433,
      "rotation_flip": 0.007695596199482679,
      "sparse_tokens": 32121.0,
      "step": 1269,
      "turn_loss": 0.07260767370462418,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.05900390262033079,
      "grad_norm": 1.418540596961975,
      "learning_rate": 9.770964344051139e-06,
      "loss": 0.3052,
      "mae_dtheta": 0.03141193464398384,
      "mae_dx": 0.01598842442035675,
      "mae_dy": 0.005928634200245142,
      "pose_mae_dtheta": 0.23256650567054749,
      "pose_mae_dx": 0.12218809872865677,
      "pose_mae_dy": 0.0570489875972271,
      "pose_rmse_dtheta": 0.4318813383579254,
      "pose_rmse_dx": 0.2760745584964752,
      "pose_rmse_dy": 0.13269294798374176,
      "pose_rmse_mean": 0.2802162766456604,
      "rmse_dtheta": 0.04924827069044113,
      "rmse_dx": 0.030387140810489655,
      "rmse_dy": 0.014587242156267166,
      "rmse_mean": 0.03140754997730255,
      "rotation_flip": 0.010660980828106403,
      "sparse_tokens": 7786.0,
      "step": 1270,
      "turn_loss": 0.41086283326148987,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.059050362386173574,
      "grad_norm": 0.5209622979164124,
      "learning_rate": 9.770568579594803e-06,
      "loss": 0.1178,
      "mae_dtheta": 0.009006397798657417,
      "mae_dx": 0.0017199059948325157,
      "mae_dy": 0.001605306752026081,
      "pose_mae_dtheta": 0.06864497810602188,
      "pose_mae_dx": 0.02026977948844433,
      "pose_mae_dy": 0.025808459147810936,
      "pose_rmse_dtheta": 0.18717072904109955,
      "pose_rmse_dx": 0.055695850402116776,
      "pose_rmse_dy": 0.05939715728163719,
      "pose_rmse_mean": 0.10075458139181137,
      "rmse_dtheta": 0.02208658680319786,
      "rmse_dx": 0.005673818290233612,
      "rmse_dy": 0.0031786966137588024,
      "rmse_mean": 0.010313034057617188,
      "rotation_flip": 0.002945508109405637,
      "sparse_tokens": 32073.0,
      "step": 1271,
      "turn_loss": 0.06874187290668488,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.05909682215201635,
      "grad_norm": 0.671002984046936,
      "learning_rate": 9.770172481530045e-06,
      "loss": 0.1286,
      "mae_dtheta": 0.02981175109744072,
      "mae_dx": 0.013988112099468708,
      "mae_dy": 0.005700490437448025,
      "pose_mae_dtheta": 0.22993308305740356,
      "pose_mae_dx": 0.11961952596902847,
      "pose_mae_dy": 0.08352126181125641,
      "pose_rmse_dtheta": 0.3807216286659241,
      "pose_rmse_dx": 0.25641700625419617,
      "pose_rmse_dy": 0.18319879472255707,
      "pose_rmse_mean": 0.27344581484794617,
      "rmse_dtheta": 0.044931091368198395,
      "rmse_dx": 0.02774120680987835,
      "rmse_dy": 0.010431831702589989,
      "rmse_mean": 0.027701377868652344,
      "rotation_flip": 0.008294930681586266,
      "sparse_tokens": 19786.0,
      "step": 1272,
      "turn_loss": 0.26429611444473267,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.059143281917859135,
      "grad_norm": 0.819280743598938,
      "learning_rate": 9.769776049884564e-06,
      "loss": 0.2212,
      "mae_dtheta": 0.03866111859679222,
      "mae_dx": 0.013924447819590569,
      "mae_dy": 0.006735909730195999,
      "pose_mae_dtheta": 0.3418235778808594,
      "pose_mae_dx": 0.09977879375219345,
      "pose_mae_dy": 0.07043105363845825,
      "pose_rmse_dtheta": 0.5798743963241577,
      "pose_rmse_dx": 0.21467991173267365,
      "pose_rmse_dy": 0.1800786703824997,
      "pose_rmse_mean": 0.32487767934799194,
      "rmse_dtheta": 0.05813879519701004,
      "rmse_dx": 0.026767626404762268,
      "rmse_dy": 0.016016777604818344,
      "rmse_mean": 0.033641066402196884,
      "rotation_flip": 0.01307759340852499,
      "sparse_tokens": 19120.0,
      "step": 1273,
      "turn_loss": 0.3461914658546448,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.05918974168370191,
      "grad_norm": 0.3834751844406128,
      "learning_rate": 9.769379284686084e-06,
      "loss": 0.1416,
      "mae_dtheta": 0.03799167275428772,
      "mae_dx": 0.015198811888694763,
      "mae_dy": 0.00792428757995367,
      "pose_mae_dtheta": 0.3019828796386719,
      "pose_mae_dx": 0.1158948689699173,
      "pose_mae_dy": 0.08937154710292816,
      "pose_rmse_dtheta": 0.5493428111076355,
      "pose_rmse_dx": 0.21724389493465424,
      "pose_rmse_dy": 0.21193711459636688,
      "pose_rmse_mean": 0.32617461681365967,
      "rmse_dtheta": 0.0572136826813221,
      "rmse_dx": 0.026745660230517387,
      "rmse_dy": 0.015828877687454224,
      "rmse_mean": 0.033262740820646286,
      "rotation_flip": 0.021276595070958138,
      "sparse_tokens": 6339.0,
      "step": 1274,
      "turn_loss": 0.432528555393219,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.059236201449544695,
      "grad_norm": 0.7980321049690247,
      "learning_rate": 9.768982185962353e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.013501567766070366,
      "mae_dx": 0.002457760041579604,
      "mae_dy": 0.0032638597767800093,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7980323433876038,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.97679138183594,
      "model/head/act_norm_mean": 104.5907315340909,
      "model/head/act_norm_min": 58.636878967285156,
      "model/head/act_over_embed": 71.87572990408334,
      "model/head/grad_frac": 0.07458831369876862,
      "model/head/grad_norm": 0.05952388420701027,
      "model/head/grad_zero_frac": 0.0001817967277020216,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6827750157828283,
      "model/head/update_ratio": 0.0010366220958530903,
      "model/head/weight_delta": 4.005018711090088,
      "model/head/weight_delta_rel": 0.07025989145040512,
      "model/head/weight_norm": 57.42100524902344,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41200920939445496,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4119297010929824,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41186442971229553,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28308194713772,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05866454914212227,
      "model/modality_embedder.encoders.pose/grad_norm": 0.046816207468509674,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5435316593886463,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015246348921209574,
      "model/modality_embedder.encoders.pose/weight_delta": 1.2762476205825806,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.041698988527059555,
      "model/modality_embedder.encoders.pose/weight_norm": 30.706504821777344,
      "model/modality_embedder/grad_frac": 0.05866454914212227,
      "model/modality_embedder/grad_norm": 0.046816207468509674,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5435316593886463,
      "model/modality_embedder/update_ratio": 0.0015246348921209574,
      "model/modality_embedder/weight_delta": 1.2762476205825806,
      "model/modality_embedder/weight_delta_rel": 0.041698988527059555,
      "model/modality_embedder/weight_norm": 30.706504821777344,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.82530975341797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.853978775853776,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.068681716918945,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.705468177087045,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07279123365879059,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.058089759200811386,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0021090900991111994,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.6909845471382141,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.025179894641041756,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.542570114135742,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.68141174316406,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.943630250921917,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.116877555847168,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.45428687223171,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06918329000473022,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.055210500955581665,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019001889741048217,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.8502436876296997,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.029453106224536896,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.055269241333008,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.78929138183594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.928215688632356,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.517577171325684,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.818112565007922,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07242617756128311,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05779843032360077,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019277719547972083,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.8946576714515686,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.030040929093956947,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.981985092163086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.90960693359375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.829079485329487,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.774115562438965,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.12440396226544,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08117935061454773,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0647837445139885,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022029594983905554,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.762771725654602,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.02606791816651821,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.407596588134766,
      "model/normalizer/grad_frac": 0.30547747015953064,
      "model/normalizer/grad_norm": 0.24378091096878052,
      "model/normalizer/grad_zero_frac": 0.0001607164304004982,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0031312855426222086,
      "model/normalizer/weight_delta": 1.6469746828079224,
      "model/normalizer/weight_delta_rel": 0.021212080493569374,
      "model/normalizer/weight_norm": 77.85330200195312,
      "pose_mae_dtheta": 0.09631834924221039,
      "pose_mae_dx": 0.025880835950374603,
      "pose_mae_dy": 0.03265346214175224,
      "pose_rmse_dtheta": 0.2143171727657318,
      "pose_rmse_dx": 0.05799258127808571,
      "pose_rmse_dy": 0.06462346017360687,
      "pose_rmse_mean": 0.11231106519699097,
      "rmse_dtheta": 0.02648797072470188,
      "rmse_dx": 0.006562028545886278,
      "rmse_dy": 0.007588584907352924,
      "rmse_mean": 0.01354619488120079,
      "rotation_flip": 0.01011419203132391,
      "sparse_tokens": 32153.0,
      "step": 1275,
      "turn_loss": 0.11712855845689774,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.05928266121538747,
      "grad_norm": 0.5223983526229858,
      "learning_rate": 9.768584753741134e-06,
      "loss": 0.106,
      "mae_dtheta": 0.012540154159069061,
      "mae_dx": 0.0025540145579725504,
      "mae_dy": 0.003453727811574936,
      "pose_mae_dtheta": 0.08512307703495026,
      "pose_mae_dx": 0.03578086569905281,
      "pose_mae_dy": 0.04245283827185631,
      "pose_rmse_dtheta": 0.18736667931079865,
      "pose_rmse_dx": 0.10219350457191467,
      "pose_rmse_dy": 0.12065983563661575,
      "pose_rmse_mean": 0.13674001395702362,
      "rmse_dtheta": 0.02535492554306984,
      "rmse_dx": 0.00786408968269825,
      "rmse_dy": 0.009409189224243164,
      "rmse_mean": 0.014209402725100517,
      "rotation_flip": 0.0034602077212184668,
      "sparse_tokens": 32105.0,
      "step": 1276,
      "turn_loss": 0.10395069420337677,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36338.0,
      "epoch": 0.059329120981230256,
      "grad_norm": 0.507547914981842,
      "learning_rate": 9.768186988050227e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.03195396810770035,
      "mae_dx": 0.011647213250398636,
      "mae_dy": 0.005036034621298313,
      "pose_mae_dtheta": 0.23475097119808197,
      "pose_mae_dx": 0.10136186331510544,
      "pose_mae_dy": 0.054835282266139984,
      "pose_rmse_dtheta": 0.418191522359848,
      "pose_rmse_dx": 0.21699494123458862,
      "pose_rmse_dy": 0.13104112446308136,
      "pose_rmse_mean": 0.2554091811180115,
      "rmse_dtheta": 0.05177713930606842,
      "rmse_dx": 0.023487523198127747,
      "rmse_dy": 0.010892519727349281,
      "rmse_mean": 0.028719060122966766,
      "rotation_flip": 0.009511731564998627,
      "sparse_tokens": 29461.0,
      "step": 1277,
      "turn_loss": 0.24668903648853302,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.05937558074707303,
      "grad_norm": 0.6770989298820496,
      "learning_rate": 9.767788888917444e-06,
      "loss": 0.1028,
      "mae_dtheta": 0.040390387177467346,
      "mae_dx": 0.0032519123051315546,
      "mae_dy": 0.005633331835269928,
      "pose_mae_dtheta": 0.3960806429386139,
      "pose_mae_dx": 0.013182960450649261,
      "pose_mae_dy": 0.04672347009181976,
      "pose_rmse_dtheta": 0.7169914245605469,
      "pose_rmse_dx": 0.02919549122452736,
      "pose_rmse_dy": 0.1078338697552681,
      "pose_rmse_mean": 0.2846736013889313,
      "rmse_dtheta": 0.06331125646829605,
      "rmse_dx": 0.007366539444774389,
      "rmse_dy": 0.012295868247747421,
      "rmse_mean": 0.02765788696706295,
      "rotation_flip": 0.007547169923782349,
      "sparse_tokens": 3918.0,
      "step": 1278,
      "turn_loss": 0.3042963743209839,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 12351.0,
      "epoch": 0.059422040512915816,
      "grad_norm": 0.528249204158783,
      "learning_rate": 9.767390456370625e-06,
      "loss": 0.1141,
      "mae_dtheta": 0.045688923448324203,
      "mae_dx": 0.008855428546667099,
      "mae_dy": 0.011656670831143856,
      "pose_mae_dtheta": 0.3628899157047272,
      "pose_mae_dx": 0.07510800659656525,
      "pose_mae_dy": 0.10593020915985107,
      "pose_rmse_dtheta": 0.602792501449585,
      "pose_rmse_dx": 0.16191108524799347,
      "pose_rmse_dy": 0.23136664927005768,
      "pose_rmse_mean": 0.33202341198921204,
      "rmse_dtheta": 0.0650404840707779,
      "rmse_dx": 0.018572257831692696,
      "rmse_dy": 0.01988905481994152,
      "rmse_mean": 0.0345005989074707,
      "rotation_flip": 0.022727273404598236,
      "sparse_tokens": 10347.0,
      "step": 1279,
      "turn_loss": 0.406948983669281,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.05946850027875859,
      "grad_norm": 0.5386489629745483,
      "learning_rate": 9.766991690437633e-06,
      "loss": 0.0916,
      "mae_dtheta": 0.009479687549173832,
      "mae_dx": 0.001774732256308198,
      "mae_dy": 0.0014981351559981704,
      "pose_mae_dtheta": 0.07217046618461609,
      "pose_mae_dx": 0.021831750869750977,
      "pose_mae_dy": 0.024146724492311478,
      "pose_rmse_dtheta": 0.22455807030200958,
      "pose_rmse_dx": 0.0639214739203453,
      "pose_rmse_dy": 0.05761260166764259,
      "pose_rmse_mean": 0.11536404490470886,
      "rmse_dtheta": 0.02477957122027874,
      "rmse_dx": 0.006288906093686819,
      "rmse_dy": 0.0033368533477187157,
      "rmse_mean": 0.011468444019556046,
      "rotation_flip": 0.004558404441922903,
      "sparse_tokens": 32073.0,
      "step": 1280,
      "turn_loss": 0.06532327085733414,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.05951496004460138,
      "grad_norm": 0.515648365020752,
      "learning_rate": 9.766592591146353e-06,
      "loss": 0.1414,
      "mae_dtheta": 0.009924150072038174,
      "mae_dx": 0.002500406000763178,
      "mae_dy": 0.002898326376453042,
      "pose_mae_dtheta": 0.07376443594694138,
      "pose_mae_dx": 0.025575945153832436,
      "pose_mae_dy": 0.03167153149843216,
      "pose_rmse_dtheta": 0.1704098880290985,
      "pose_rmse_dx": 0.07880835235118866,
      "pose_rmse_dy": 0.07548927515745163,
      "pose_rmse_mean": 0.10823583602905273,
      "rmse_dtheta": 0.020890550687909126,
      "rmse_dx": 0.008610066026449203,
      "rmse_dy": 0.007928144186735153,
      "rmse_mean": 0.01247625332325697,
      "rotation_flip": 0.00625521270558238,
      "sparse_tokens": 32073.0,
      "step": 1281,
      "turn_loss": 0.10696939378976822,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.059561419810444154,
      "grad_norm": 0.6429486274719238,
      "learning_rate": 9.766193158524693e-06,
      "loss": 0.1071,
      "mae_dtheta": 0.008448576554656029,
      "mae_dx": 0.001902169082313776,
      "mae_dy": 0.0003197965561412275,
      "pose_mae_dtheta": 0.06424445658922195,
      "pose_mae_dx": 0.016321446746587753,
      "pose_mae_dy": 0.004637276753783226,
      "pose_rmse_dtheta": 0.25718748569488525,
      "pose_rmse_dx": 0.03934163227677345,
      "pose_rmse_dy": 0.010103641077876091,
      "pose_rmse_mean": 0.10221092402935028,
      "rmse_dtheta": 0.029477402567863464,
      "rmse_dx": 0.0052568865939974785,
      "rmse_dy": 0.0005806144326925278,
      "rmse_mean": 0.011771634221076965,
      "rotation_flip": 0.0034110289998352528,
      "sparse_tokens": 32217.0,
      "step": 1282,
      "turn_loss": 0.055578988045454025,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.05960787957628694,
      "grad_norm": 0.7924227714538574,
      "learning_rate": 9.765793392600589e-06,
      "loss": 0.2172,
      "mae_dtheta": 0.0435686819255352,
      "mae_dx": 0.014067912474274635,
      "mae_dy": 0.007039322517812252,
      "pose_mae_dtheta": 0.3572131395339966,
      "pose_mae_dx": 0.12692959606647491,
      "pose_mae_dy": 0.08864226192235947,
      "pose_rmse_dtheta": 0.5597503185272217,
      "pose_rmse_dx": 0.27266985177993774,
      "pose_rmse_dy": 0.20575785636901855,
      "pose_rmse_mean": 0.34605932235717773,
      "rmse_dtheta": 0.060600023716688156,
      "rmse_dx": 0.02698245644569397,
      "rmse_dy": 0.014619491994380951,
      "rmse_mean": 0.03406732529401779,
      "rotation_flip": 0.02054155059158802,
      "sparse_tokens": 14577.0,
      "step": 1283,
      "turn_loss": 0.40632331371307373,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.059654339342129714,
      "grad_norm": 0.5894407629966736,
      "learning_rate": 9.765393293401995e-06,
      "loss": 0.1494,
      "mae_dtheta": 0.013419881463050842,
      "mae_dx": 0.002197650261223316,
      "mae_dy": 0.0034585820976644754,
      "pose_mae_dtheta": 0.09677937626838684,
      "pose_mae_dx": 0.034934043884277344,
      "pose_mae_dy": 0.048472609370946884,
      "pose_rmse_dtheta": 0.19336962699890137,
      "pose_rmse_dx": 0.07787895947694778,
      "pose_rmse_dy": 0.11086031794548035,
      "pose_rmse_mean": 0.12736964225769043,
      "rmse_dtheta": 0.024344472214579582,
      "rmse_dx": 0.00671081617474556,
      "rmse_dy": 0.006550775375217199,
      "rmse_mean": 0.012535355053842068,
      "rotation_flip": 0.009153317660093307,
      "sparse_tokens": 32105.0,
      "step": 1284,
      "turn_loss": 0.11062177270650864,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8139.0,
      "epoch": 0.0597007991079725,
      "grad_norm": 0.5963743925094604,
      "learning_rate": 9.76499286095689e-06,
      "loss": 0.1703,
      "mae_dtheta": 0.03621866926550865,
      "mae_dx": 0.012284328229725361,
      "mae_dy": 0.00835814606398344,
      "pose_mae_dtheta": 0.24687661230564117,
      "pose_mae_dx": 0.12018837779760361,
      "pose_mae_dy": 0.11091390997171402,
      "pose_rmse_dtheta": 0.39818069338798523,
      "pose_rmse_dx": 0.2540212571620941,
      "pose_rmse_dy": 0.20462897419929504,
      "pose_rmse_mean": 0.2856103181838989,
      "rmse_dtheta": 0.050873689353466034,
      "rmse_dx": 0.026107707992196083,
      "rmse_dy": 0.013049522414803505,
      "rmse_mean": 0.03001030534505844,
      "rotation_flip": 0.022900763899087906,
      "sparse_tokens": 7006.0,
      "step": 1285,
      "turn_loss": 0.3092770576477051,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 8762.0,
      "epoch": 0.059747258873815275,
      "grad_norm": 0.49633845686912537,
      "learning_rate": 9.764592095293278e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.04741739481687546,
      "mae_dx": 0.012040452100336552,
      "mae_dy": 0.0028349070344120264,
      "pose_mae_dtheta": 0.3781646192073822,
      "pose_mae_dx": 0.09846977144479752,
      "pose_mae_dy": 0.026046955958008766,
      "pose_rmse_dtheta": 0.6358752846717834,
      "pose_rmse_dx": 0.21934331953525543,
      "pose_rmse_dy": 0.07325953990221024,
      "pose_rmse_mean": 0.30949270725250244,
      "rmse_dtheta": 0.0669313296675682,
      "rmse_dx": 0.025336535647511482,
      "rmse_dy": 0.0074844020418822765,
      "rmse_mean": 0.033250756561756134,
      "rotation_flip": 0.010729613713920116,
      "sparse_tokens": 7171.0,
      "step": 1286,
      "turn_loss": 0.2539460361003876,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.05979371863965806,
      "grad_norm": 0.6212415099143982,
      "learning_rate": 9.764190996439181e-06,
      "loss": 0.135,
      "mae_dtheta": 0.012413152493536472,
      "mae_dx": 0.0022365800105035305,
      "mae_dy": 0.00269200443290174,
      "pose_mae_dtheta": 0.08000173419713974,
      "pose_mae_dx": 0.027878770604729652,
      "pose_mae_dy": 0.03465813770890236,
      "pose_rmse_dtheta": 0.1519564539194107,
      "pose_rmse_dx": 0.07241690903902054,
      "pose_rmse_dy": 0.07288142293691635,
      "pose_rmse_mean": 0.09908493608236313,
      "rmse_dtheta": 0.02160566858947277,
      "rmse_dx": 0.00724301440641284,
      "rmse_dy": 0.004803691990673542,
      "rmse_mean": 0.011217459104955196,
      "rotation_flip": 0.007751937955617905,
      "sparse_tokens": 32105.0,
      "step": 1287,
      "turn_loss": 0.10470922291278839,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.059840178405500835,
      "grad_norm": 0.737484872341156,
      "learning_rate": 9.763789564422652e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.037774961441755295,
      "mae_dx": 0.012795515358448029,
      "mae_dy": 0.004876202438026667,
      "pose_mae_dtheta": 0.27949559688568115,
      "pose_mae_dx": 0.09757356345653534,
      "pose_mae_dy": 0.08247724920511246,
      "pose_rmse_dtheta": 0.5180991291999817,
      "pose_rmse_dx": 0.22033174335956573,
      "pose_rmse_dy": 0.17713947594165802,
      "pose_rmse_mean": 0.3051901161670685,
      "rmse_dtheta": 0.05710187181830406,
      "rmse_dx": 0.026388753205537796,
      "rmse_dy": 0.009033605456352234,
      "rmse_mean": 0.030841410160064697,
      "rotation_flip": 0.013993541710078716,
      "sparse_tokens": 16327.0,
      "step": 1288,
      "turn_loss": 0.29219627380371094,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.05988663817134362,
      "grad_norm": 0.5443590879440308,
      "learning_rate": 9.763387799271761e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.03094644472002983,
      "mae_dx": 0.008230551145970821,
      "mae_dy": 0.005584609694778919,
      "pose_mae_dtheta": 0.24968871474266052,
      "pose_mae_dx": 0.06322275102138519,
      "pose_mae_dy": 0.0565340556204319,
      "pose_rmse_dtheta": 0.4515097439289093,
      "pose_rmse_dx": 0.14535948634147644,
      "pose_rmse_dy": 0.10851553082466125,
      "pose_rmse_mean": 0.235128253698349,
      "rmse_dtheta": 0.047260578721761703,
      "rmse_dx": 0.017815768718719482,
      "rmse_dy": 0.00903189368546009,
      "rmse_mean": 0.02470274828374386,
      "rotation_flip": 0.009836065582931042,
      "sparse_tokens": 5151.0,
      "step": 1289,
      "turn_loss": 0.2546866238117218,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.059933097937186396,
      "grad_norm": 0.6287367939949036,
      "learning_rate": 9.762985701014606e-06,
      "loss": 0.2214,
      "mae_dtheta": 0.043546322733163834,
      "mae_dx": 0.013347002677619457,
      "mae_dy": 0.005453509744256735,
      "pose_mae_dtheta": 0.34864282608032227,
      "pose_mae_dx": 0.10847993195056915,
      "pose_mae_dy": 0.056826796382665634,
      "pose_rmse_dtheta": 0.5779508948326111,
      "pose_rmse_dx": 0.2184104174375534,
      "pose_rmse_dy": 0.12134501338005066,
      "pose_rmse_mean": 0.3059021234512329,
      "rmse_dtheta": 0.06166872754693031,
      "rmse_dx": 0.025423061102628708,
      "rmse_dy": 0.009570485912263393,
      "rmse_mean": 0.032220758497714996,
      "rotation_flip": 0.01799485832452774,
      "sparse_tokens": 18748.0,
      "step": 1290,
      "turn_loss": 0.30261462926864624,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.05997955770302918,
      "grad_norm": 0.6210680603981018,
      "learning_rate": 9.762583269679304e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.014827806502580643,
      "mae_dx": 0.0025276639498770237,
      "mae_dy": 0.004405822139233351,
      "pose_mae_dtheta": 0.10135858505964279,
      "pose_mae_dx": 0.03955120965838432,
      "pose_mae_dy": 0.04808929190039635,
      "pose_rmse_dtheta": 0.20069852471351624,
      "pose_rmse_dx": 0.10062133520841599,
      "pose_rmse_dy": 0.10426845401525497,
      "pose_rmse_mean": 0.13519611954689026,
      "rmse_dtheta": 0.02618960477411747,
      "rmse_dx": 0.006283935159444809,
      "rmse_dy": 0.009261256083846092,
      "rmse_mean": 0.013911600224673748,
      "rotation_flip": 0.003342245938256383,
      "sparse_tokens": 32073.0,
      "step": 1291,
      "turn_loss": 0.13252660632133484,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.060026017468871956,
      "grad_norm": 0.4549494981765747,
      "learning_rate": 9.762180505293996e-06,
      "loss": 0.0881,
      "mae_dtheta": 0.00698110880330205,
      "mae_dx": 0.0016198508674278855,
      "mae_dy": 0.0010507663246244192,
      "pose_mae_dtheta": 0.05103554576635361,
      "pose_mae_dx": 0.015656743198633194,
      "pose_mae_dy": 0.016013111919164658,
      "pose_rmse_dtheta": 0.16724449396133423,
      "pose_rmse_dx": 0.041432786732912064,
      "pose_rmse_dy": 0.044007398188114166,
      "pose_rmse_mean": 0.08422823250293732,
      "rmse_dtheta": 0.02166750095784664,
      "rmse_dx": 0.00498585682362318,
      "rmse_dy": 0.0023997488897293806,
      "rmse_mean": 0.009684368968009949,
      "rotation_flip": 0.003948110621422529,
      "sparse_tokens": 32121.0,
      "step": 1292,
      "turn_loss": 0.06256576627492905,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15267.0,
      "epoch": 0.06007247723471474,
      "grad_norm": 0.7236459851264954,
      "learning_rate": 9.761777407886851e-06,
      "loss": 0.1794,
      "mae_dtheta": 0.025320734828710556,
      "mae_dx": 0.007378599606454372,
      "mae_dy": 0.0050081899389624596,
      "pose_mae_dtheta": 0.17552882432937622,
      "pose_mae_dx": 0.05712331458926201,
      "pose_mae_dy": 0.06106287240982056,
      "pose_rmse_dtheta": 0.339592844247818,
      "pose_rmse_dx": 0.14971312880516052,
      "pose_rmse_dy": 0.12444209307432175,
      "pose_rmse_mean": 0.20458269119262695,
      "rmse_dtheta": 0.04119902476668358,
      "rmse_dx": 0.01758694462478161,
      "rmse_dy": 0.009201645851135254,
      "rmse_mean": 0.022662539035081863,
      "rotation_flip": 0.017094017937779427,
      "sparse_tokens": 12221.0,
      "step": 1293,
      "turn_loss": 0.2495441436767578,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 16513.0,
      "epoch": 0.06011893700055752,
      "grad_norm": 0.7658644914627075,
      "learning_rate": 9.761373977486056e-06,
      "loss": 0.1849,
      "mae_dtheta": 0.028898481279611588,
      "mae_dx": 0.01615176536142826,
      "mae_dy": 0.005633373744785786,
      "pose_mae_dtheta": 0.21438278257846832,
      "pose_mae_dx": 0.15706084668636322,
      "pose_mae_dy": 0.0706353709101677,
      "pose_rmse_dtheta": 0.3527860939502716,
      "pose_rmse_dx": 0.3003205955028534,
      "pose_rmse_dy": 0.12016095221042633,
      "pose_rmse_mean": 0.2577558755874634,
      "rmse_dtheta": 0.0414704829454422,
      "rmse_dx": 0.02902534045279026,
      "rmse_dy": 0.008999345824122429,
      "rmse_mean": 0.02649839036166668,
      "rotation_flip": 0.01032258104532957,
      "sparse_tokens": 12990.0,
      "step": 1294,
      "turn_loss": 0.2872229516506195,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.0601653967664003,
      "grad_norm": 0.5101978778839111,
      "learning_rate": 9.760970214119822e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.007935333997011185,
      "mae_dx": 0.0017121653072535992,
      "mae_dy": 0.0013538133352994919,
      "pose_mae_dtheta": 0.05004684999585152,
      "pose_mae_dx": 0.021207772195339203,
      "pose_mae_dy": 0.018341224640607834,
      "pose_rmse_dtheta": 0.13790281116962433,
      "pose_rmse_dx": 0.05151344835758209,
      "pose_rmse_dy": 0.049291063100099564,
      "pose_rmse_mean": 0.07956910878419876,
      "rmse_dtheta": 0.020537616685032845,
      "rmse_dx": 0.004895495716482401,
      "rmse_dy": 0.0030509917996823788,
      "rmse_mean": 0.009494701400399208,
      "rotation_flip": 0.0021175225265324116,
      "sparse_tokens": 32105.0,
      "step": 1295,
      "turn_loss": 0.06119086593389511,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.06021185653224308,
      "grad_norm": 0.40484893321990967,
      "learning_rate": 9.760566117816387e-06,
      "loss": 0.0805,
      "mae_dtheta": 0.034864965826272964,
      "mae_dx": 0.014299844391644001,
      "mae_dy": 0.004774418193846941,
      "pose_mae_dtheta": 0.26395219564437866,
      "pose_mae_dx": 0.11650866270065308,
      "pose_mae_dy": 0.06934796273708344,
      "pose_rmse_dtheta": 0.43770068883895874,
      "pose_rmse_dx": 0.24232077598571777,
      "pose_rmse_dy": 0.14915308356285095,
      "pose_rmse_mean": 0.27639150619506836,
      "rmse_dtheta": 0.05309171974658966,
      "rmse_dx": 0.026595020666718483,
      "rmse_dy": 0.008929858915507793,
      "rmse_mean": 0.029538866132497787,
      "rotation_flip": 0.016209475696086884,
      "sparse_tokens": 12676.0,
      "step": 1296,
      "turn_loss": 0.2646516263484955,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.06025831629808586,
      "grad_norm": 0.7237063646316528,
      "learning_rate": 9.760161688604008e-06,
      "loss": 0.1476,
      "mae_dtheta": 0.012080143205821514,
      "mae_dx": 0.0023240295704454184,
      "mae_dy": 0.002051327144727111,
      "pose_mae_dtheta": 0.08519536256790161,
      "pose_mae_dx": 0.027756154537200928,
      "pose_mae_dy": 0.028355009853839874,
      "pose_rmse_dtheta": 0.2032494992017746,
      "pose_rmse_dx": 0.06767743080854416,
      "pose_rmse_dy": 0.06810478866100311,
      "pose_rmse_mean": 0.11301057040691376,
      "rmse_dtheta": 0.026009080931544304,
      "rmse_dx": 0.006665098946541548,
      "rmse_dy": 0.004646450746804476,
      "rmse_mean": 0.012440210208296776,
      "rotation_flip": 0.00369822490029037,
      "sparse_tokens": 32169.0,
      "step": 1297,
      "turn_loss": 0.09829579293727875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32015.0,
      "epoch": 0.06030477606392864,
      "grad_norm": 0.6291419267654419,
      "learning_rate": 9.759756926510966e-06,
      "loss": 0.2441,
      "mae_dtheta": 0.0376596562564373,
      "mae_dx": 0.013599473051726818,
      "mae_dy": 0.008411598391830921,
      "pose_mae_dtheta": 0.30255749821662903,
      "pose_mae_dx": 0.1130884513258934,
      "pose_mae_dy": 0.10380450636148453,
      "pose_rmse_dtheta": 0.4902072250843048,
      "pose_rmse_dx": 0.22655706107616425,
      "pose_rmse_dy": 0.2219226211309433,
      "pose_rmse_mean": 0.31289565563201904,
      "rmse_dtheta": 0.05326893553137779,
      "rmse_dx": 0.02583085559308529,
      "rmse_dy": 0.015705253928899765,
      "rmse_mean": 0.031601682305336,
      "rotation_flip": 0.012422360479831696,
      "sparse_tokens": 26331.0,
      "step": 1298,
      "turn_loss": 0.36354079842567444,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.06035123582977142,
      "grad_norm": 0.45290058851242065,
      "learning_rate": 9.75935183156557e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.012303473427891731,
      "mae_dx": 0.003059706650674343,
      "mae_dy": 0.0022597317583858967,
      "pose_mae_dtheta": 0.08674178272485733,
      "pose_mae_dx": 0.032951727509498596,
      "pose_mae_dy": 0.033186595886945724,
      "pose_rmse_dtheta": 0.2035146802663803,
      "pose_rmse_dx": 0.09383943676948547,
      "pose_rmse_dy": 0.07524605840444565,
      "pose_rmse_mean": 0.12420006096363068,
      "rmse_dtheta": 0.025754790753126144,
      "rmse_dx": 0.009906764142215252,
      "rmse_dy": 0.004620484542101622,
      "rmse_mean": 0.01342734694480896,
      "rotation_flip": 0.004349927417933941,
      "sparse_tokens": 32089.0,
      "step": 1299,
      "turn_loss": 0.10774171352386475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.0603976955956142,
      "grad_norm": 0.46556466817855835,
      "learning_rate": 9.758946403796144e-06,
      "loss": 0.1404,
      "mae_dtheta": 0.03496583551168442,
      "mae_dx": 0.01605110615491867,
      "mae_dy": 0.004780648276209831,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4655645489692688,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 132.29013061523438,
      "model/head/act_norm_mean": 101.12984095982142,
      "model/head/act_norm_min": 80.44535827636719,
      "model/head/act_over_embed": 69.4973735000773,
      "model/head/grad_frac": 0.11083358526229858,
      "model/head/grad_norm": 0.05160018801689148,
      "model/head/grad_zero_frac": 0.00018147945229429752,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6822823660714286,
      "model/head/update_ratio": 0.0008985134190879762,
      "model/head/weight_delta": 4.04015588760376,
      "model/head/weight_delta_rel": 0.07087630033493042,
      "model/head/weight_norm": 57.42839813232422,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4120742380619049,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4120742380619049,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4120742380619049,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28318127429594,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06856882572174072,
      "model/modality_embedder.encoders.pose/grad_norm": 0.031923215836286545,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001039555761963129,
      "model/modality_embedder.encoders.pose/weight_delta": 1.294430136680603,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.04229306802153587,
      "model/modality_embedder.encoders.pose/weight_norm": 30.70851707458496,
      "model/modality_embedder/grad_frac": 0.06856882572174072,
      "model/modality_embedder/grad_norm": 0.031923215836286545,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.001039555761963129,
      "model/modality_embedder/weight_delta": 1.294430136680603,
      "model/modality_embedder/weight_delta_rel": 0.04229306802153587,
      "model/modality_embedder/weight_norm": 30.70851707458496,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 67.6669921875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.513520408163266,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.101694107055664,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.471501999388671,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08401858061552048,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03911607339978218,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014201138401404023,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.7014914751052856,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.025562772527337074,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.544322967529297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 69.66920471191406,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.425357851473922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.674264907836914,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.098125227188397,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08599499613046646,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.040036220103502274,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013777702115476131,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.8637329339981079,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.029920384287834167,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.058706283569336,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 71.40650177001953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.150533234126986,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.096559524536133,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.28368190149398,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09392043948173523,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04372602701187134,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001458283164538443,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.9089484214782715,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.030520785599946976,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.98459243774414,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 72.28783416748047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.156172052154194,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.146461486816406,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.661975674328733,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10177392512559891,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.047382332384586334,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016111192526295781,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.7752729654312134,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.026495151221752167,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.409574508666992,
      "model/normalizer/grad_frac": 0.29556816816329956,
      "model/normalizer/grad_norm": 0.13760605454444885,
      "model/normalizer/grad_zero_frac": 0.00023752942797727883,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017674269620329142,
      "model/normalizer/weight_delta": 1.673282265663147,
      "model/normalizer/weight_delta_rel": 0.02155090682208538,
      "model/normalizer/weight_norm": 77.8567123413086,
      "pose_mae_dtheta": 0.26680782437324524,
      "pose_mae_dx": 0.12924806773662567,
      "pose_mae_dy": 0.06403616070747375,
      "pose_rmse_dtheta": 0.4406018853187561,
      "pose_rmse_dx": 0.2877451181411743,
      "pose_rmse_dy": 0.13158057630062103,
      "pose_rmse_mean": 0.28664255142211914,
      "rmse_dtheta": 0.04921624809503555,
      "rmse_dx": 0.030628535896539688,
      "rmse_dy": 0.008685530163347721,
      "rmse_mean": 0.02951010689139366,
      "rotation_flip": 0.017077798023819923,
      "sparse_tokens": 9139.0,
      "step": 1300,
      "turn_loss": 0.2586078345775604,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.060444155361456975,
      "grad_norm": 0.5353533029556274,
      "learning_rate": 9.758540643231041e-06,
      "loss": 0.1331,
      "mae_dtheta": 0.03454803675413132,
      "mae_dx": 0.011006872169673443,
      "mae_dy": 0.003734008641913533,
      "pose_mae_dtheta": 0.30254119634628296,
      "pose_mae_dx": 0.08072143793106079,
      "pose_mae_dy": 0.05014806240797043,
      "pose_rmse_dtheta": 0.4929296374320984,
      "pose_rmse_dx": 0.19237178564071655,
      "pose_rmse_dy": 0.13225898146629333,
      "pose_rmse_mean": 0.27252015471458435,
      "rmse_dtheta": 0.04996310919523239,
      "rmse_dx": 0.02303074672818184,
      "rmse_dy": 0.009180131368339062,
      "rmse_mean": 0.027391329407691956,
      "rotation_flip": 0.012558870017528534,
      "sparse_tokens": 10093.0,
      "step": 1301,
      "turn_loss": 0.24480068683624268,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.06049061512729976,
      "grad_norm": 0.6840839385986328,
      "learning_rate": 9.758134549898636e-06,
      "loss": 0.2209,
      "mae_dtheta": 0.022763567045331,
      "mae_dx": 0.005932977423071861,
      "mae_dy": 0.002324252389371395,
      "pose_mae_dtheta": 0.1295650154352188,
      "pose_mae_dx": 0.03868937864899635,
      "pose_mae_dy": 0.024354681372642517,
      "pose_rmse_dtheta": 0.23830631375312805,
      "pose_rmse_dx": 0.12401153147220612,
      "pose_rmse_dy": 0.07124428451061249,
      "pose_rmse_mean": 0.14452072978019714,
      "rmse_dtheta": 0.04025989770889282,
      "rmse_dx": 0.01511385664343834,
      "rmse_dy": 0.006204117089509964,
      "rmse_mean": 0.020525958389043808,
      "rotation_flip": 0.017301037907600403,
      "sparse_tokens": 4842.0,
      "step": 1302,
      "turn_loss": 0.13959501683712006,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.060537074893142535,
      "grad_norm": 0.37967175245285034,
      "learning_rate": 9.75772812382733e-06,
      "loss": 0.1139,
      "mae_dtheta": 0.04094044491648674,
      "mae_dx": 0.016123641282320023,
      "mae_dy": 0.006050687283277512,
      "pose_mae_dtheta": 0.3189290463924408,
      "pose_mae_dx": 0.10818930715322495,
      "pose_mae_dy": 0.06951108574867249,
      "pose_rmse_dtheta": 0.5331314206123352,
      "pose_rmse_dx": 0.23267148435115814,
      "pose_rmse_dy": 0.1716708093881607,
      "pose_rmse_mean": 0.312491238117218,
      "rmse_dtheta": 0.05905197560787201,
      "rmse_dx": 0.02970818616449833,
      "rmse_dy": 0.012623529881238937,
      "rmse_mean": 0.03379456326365471,
      "rotation_flip": 0.014409221708774567,
      "sparse_tokens": 11783.0,
      "step": 1303,
      "turn_loss": 0.3511185348033905,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.06058353465898532,
      "grad_norm": 0.6304446458816528,
      "learning_rate": 9.757321365045542e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.011267184279859066,
      "mae_dx": 0.0019788502249866724,
      "mae_dy": 0.0017416230402886868,
      "pose_mae_dtheta": 0.08445041626691818,
      "pose_mae_dx": 0.022373832762241364,
      "pose_mae_dy": 0.026671338826417923,
      "pose_rmse_dtheta": 0.20821130275726318,
      "pose_rmse_dx": 0.053688570857048035,
      "pose_rmse_dy": 0.06944510340690613,
      "pose_rmse_mean": 0.11044833064079285,
      "rmse_dtheta": 0.025493452325463295,
      "rmse_dx": 0.005903514102101326,
      "rmse_dy": 0.0038722266908735037,
      "rmse_mean": 0.011756397783756256,
      "rotation_flip": 0.005470887292176485,
      "sparse_tokens": 32169.0,
      "step": 1304,
      "turn_loss": 0.08580289036035538,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27494.0,
      "epoch": 0.060629994424828096,
      "grad_norm": 0.5754655599594116,
      "learning_rate": 9.75691427358172e-06,
      "loss": 0.1676,
      "mae_dtheta": 0.035374049097299576,
      "mae_dx": 0.01503620482981205,
      "mae_dy": 0.006043341942131519,
      "pose_mae_dtheta": 0.2898492217063904,
      "pose_mae_dx": 0.1167064905166626,
      "pose_mae_dy": 0.08464658260345459,
      "pose_rmse_dtheta": 0.48994576930999756,
      "pose_rmse_dx": 0.2430601418018341,
      "pose_rmse_dy": 0.20671194791793823,
      "pose_rmse_mean": 0.31323927640914917,
      "rmse_dtheta": 0.05269475653767586,
      "rmse_dx": 0.0281671229749918,
      "rmse_dy": 0.012404902838170528,
      "rmse_mean": 0.031088929623365402,
      "rotation_flip": 0.017770597711205482,
      "sparse_tokens": 22904.0,
      "step": 1305,
      "turn_loss": 0.24731501936912537,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.06067645419067088,
      "grad_norm": 0.49567732214927673,
      "learning_rate": 9.756506849464327e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.048002973198890686,
      "mae_dx": 0.008791236206889153,
      "mae_dy": 0.0030806821305304766,
      "pose_mae_dtheta": 0.4312591552734375,
      "pose_mae_dx": 0.07119093090295792,
      "pose_mae_dy": 0.037821173667907715,
      "pose_rmse_dtheta": 0.7223770022392273,
      "pose_rmse_dx": 0.15791675448417664,
      "pose_rmse_dy": 0.12040813267230988,
      "pose_rmse_mean": 0.3335673213005066,
      "rmse_dtheta": 0.06979336589574814,
      "rmse_dx": 0.01758461445569992,
      "rmse_dy": 0.007131917867809534,
      "rmse_mean": 0.03150330111384392,
      "rotation_flip": 0.011320754885673523,
      "sparse_tokens": 9540.0,
      "step": 1306,
      "turn_loss": 0.3004418611526489,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.060722913956513656,
      "grad_norm": 1.2201416492462158,
      "learning_rate": 9.756099092721856e-06,
      "loss": 0.1947,
      "mae_dtheta": 0.0315767303109169,
      "mae_dx": 0.011171597056090832,
      "mae_dy": 0.005630754865705967,
      "pose_mae_dtheta": 0.24579155445098877,
      "pose_mae_dx": 0.0835207849740982,
      "pose_mae_dy": 0.06677334755659103,
      "pose_rmse_dtheta": 0.4359374940395355,
      "pose_rmse_dx": 0.19689883291721344,
      "pose_rmse_dy": 0.16562990844249725,
      "pose_rmse_mean": 0.2661554217338562,
      "rmse_dtheta": 0.04953555017709732,
      "rmse_dx": 0.02338983491063118,
      "rmse_dy": 0.011729259043931961,
      "rmse_mean": 0.028218215331435204,
      "rotation_flip": 0.014137606136500835,
      "sparse_tokens": 15993.0,
      "step": 1307,
      "turn_loss": 0.29947903752326965,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.06076937372235644,
      "grad_norm": 0.5885235071182251,
      "learning_rate": 9.755691003382825e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.026736628264188766,
      "mae_dx": 0.007774838246405125,
      "mae_dy": 0.0032247663475573063,
      "pose_mae_dtheta": 0.20732298493385315,
      "pose_mae_dx": 0.07376807928085327,
      "pose_mae_dy": 0.054768092930316925,
      "pose_rmse_dtheta": 0.4407898485660553,
      "pose_rmse_dx": 0.21988923847675323,
      "pose_rmse_dy": 0.14468078315258026,
      "pose_rmse_mean": 0.26845329999923706,
      "rmse_dtheta": 0.04754791036248207,
      "rmse_dx": 0.0214400477707386,
      "rmse_dy": 0.006384804379194975,
      "rmse_mean": 0.025124255567789078,
      "rotation_flip": 0.005484460853040218,
      "sparse_tokens": 13256.0,
      "step": 1308,
      "turn_loss": 0.21085667610168457,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06081583348819922,
      "grad_norm": 0.5949736833572388,
      "learning_rate": 9.755282581475769e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.011316020041704178,
      "mae_dx": 0.0025330232456326485,
      "mae_dy": 0.002999847289174795,
      "pose_mae_dtheta": 0.07931489497423172,
      "pose_mae_dx": 0.032274000346660614,
      "pose_mae_dy": 0.032803554087877274,
      "pose_rmse_dtheta": 0.18969053030014038,
      "pose_rmse_dx": 0.09556646645069122,
      "pose_rmse_dy": 0.09359729290008545,
      "pose_rmse_mean": 0.12628476321697235,
      "rmse_dtheta": 0.02556798979640007,
      "rmse_dx": 0.0071939765475690365,
      "rmse_dy": 0.008336089551448822,
      "rmse_mean": 0.01369935180991888,
      "rotation_flip": 0.0036730945575982332,
      "sparse_tokens": 32105.0,
      "step": 1309,
      "turn_loss": 0.10296798497438431,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.060862293254042,
      "grad_norm": 0.48183953762054443,
      "learning_rate": 9.75487382702925e-06,
      "loss": 0.0881,
      "mae_dtheta": 0.011232122778892517,
      "mae_dx": 0.0019273251527920365,
      "mae_dy": 0.0024995540734380484,
      "pose_mae_dtheta": 0.07858256995677948,
      "pose_mae_dx": 0.02838297374546528,
      "pose_mae_dy": 0.03313121199607849,
      "pose_rmse_dtheta": 0.17587125301361084,
      "pose_rmse_dx": 0.0658903568983078,
      "pose_rmse_dy": 0.0749569982290268,
      "pose_rmse_mean": 0.10557287186384201,
      "rmse_dtheta": 0.022851943969726562,
      "rmse_dx": 0.005808833055198193,
      "rmse_dy": 0.005172246601432562,
      "rmse_mean": 0.011277674697339535,
      "rotation_flip": 0.006879805587232113,
      "sparse_tokens": 32073.0,
      "step": 1310,
      "turn_loss": 0.08922997862100601,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06090875301988478,
      "grad_norm": 0.6336639523506165,
      "learning_rate": 9.754464740071852e-06,
      "loss": 0.2209,
      "mae_dtheta": 0.01259163673967123,
      "mae_dx": 0.0027192675042897463,
      "mae_dy": 0.003069448284804821,
      "pose_mae_dtheta": 0.0933292955160141,
      "pose_mae_dx": 0.0307927243411541,
      "pose_mae_dy": 0.040146972984075546,
      "pose_rmse_dtheta": 0.20460866391658783,
      "pose_rmse_dx": 0.07953117042779922,
      "pose_rmse_dy": 0.09817952662706375,
      "pose_rmse_mean": 0.12743979692459106,
      "rmse_dtheta": 0.026022089645266533,
      "rmse_dx": 0.008374841883778572,
      "rmse_dy": 0.007443215698003769,
      "rmse_mean": 0.013946715742349625,
      "rotation_flip": 0.004321521148085594,
      "sparse_tokens": 32073.0,
      "step": 1311,
      "turn_loss": 0.10839515179395676,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30818.0,
      "epoch": 0.06095521278572756,
      "grad_norm": 0.5588403940200806,
      "learning_rate": 9.754055320632181e-06,
      "loss": 0.1724,
      "mae_dtheta": 0.02732023410499096,
      "mae_dx": 0.009691129438579082,
      "mae_dy": 0.0034105461090803146,
      "pose_mae_dtheta": 0.21352380514144897,
      "pose_mae_dx": 0.07764111459255219,
      "pose_mae_dy": 0.04310690611600876,
      "pose_rmse_dtheta": 0.4196591079235077,
      "pose_rmse_dx": 0.1910140961408615,
      "pose_rmse_dy": 0.10831954330205917,
      "pose_rmse_mean": 0.2396642416715622,
      "rmse_dtheta": 0.046970222145318985,
      "rmse_dx": 0.022082684561610222,
      "rmse_dy": 0.0070478469133377075,
      "rmse_mean": 0.02536691725254059,
      "rotation_flip": 0.011484823189675808,
      "sparse_tokens": 24462.0,
      "step": 1312,
      "turn_loss": 0.22751933336257935,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 14897.0,
      "epoch": 0.06100167255157034,
      "grad_norm": 0.6402038931846619,
      "learning_rate": 9.753645568738872e-06,
      "loss": 0.1568,
      "mae_dtheta": 0.035170651972293854,
      "mae_dx": 0.010927747935056686,
      "mae_dy": 0.0033800583332777023,
      "pose_mae_dtheta": 0.30717769265174866,
      "pose_mae_dx": 0.0787045806646347,
      "pose_mae_dy": 0.036593418568372726,
      "pose_rmse_dtheta": 0.5564029812812805,
      "pose_rmse_dx": 0.18429644405841827,
      "pose_rmse_dy": 0.0887623131275177,
      "pose_rmse_mean": 0.27648723125457764,
      "rmse_dtheta": 0.054695021361112595,
      "rmse_dx": 0.02227894589304924,
      "rmse_dy": 0.008251765742897987,
      "rmse_mean": 0.028408577665686607,
      "rotation_flip": 0.0071839080192148685,
      "sparse_tokens": 11638.0,
      "step": 1313,
      "turn_loss": 0.24115653336048126,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.06104813231741312,
      "grad_norm": 0.46865805983543396,
      "learning_rate": 9.753235484420576e-06,
      "loss": 0.0948,
      "mae_dtheta": 0.0325387679040432,
      "mae_dx": 0.006598528008908033,
      "mae_dy": 0.009251846000552177,
      "pose_mae_dtheta": 0.23248010873794556,
      "pose_mae_dx": 0.057779084891080856,
      "pose_mae_dy": 0.09773428738117218,
      "pose_rmse_dtheta": 0.42774686217308044,
      "pose_rmse_dx": 0.13836714625358582,
      "pose_rmse_dy": 0.2148122787475586,
      "pose_rmse_mean": 0.26030877232551575,
      "rmse_dtheta": 0.05198249965906143,
      "rmse_dx": 0.01626470685005188,
      "rmse_dy": 0.01793055236339569,
      "rmse_mean": 0.028725920245051384,
      "rotation_flip": 0.017999999225139618,
      "sparse_tokens": 8376.0,
      "step": 1314,
      "turn_loss": 0.2560920715332031,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 24339.0,
      "epoch": 0.0610945920832559,
      "grad_norm": 1.0998637676239014,
      "learning_rate": 9.75282506770597e-06,
      "loss": 0.1723,
      "mae_dtheta": 0.018003417178988457,
      "mae_dx": 0.008646231144666672,
      "mae_dy": 0.00448865769430995,
      "pose_mae_dtheta": 0.12966006994247437,
      "pose_mae_dx": 0.07825061678886414,
      "pose_mae_dy": 0.06807851791381836,
      "pose_rmse_dtheta": 0.25162628293037415,
      "pose_rmse_dx": 0.2077949494123459,
      "pose_rmse_dy": 0.1730920672416687,
      "pose_rmse_mean": 0.21083776652812958,
      "rmse_dtheta": 0.03274158015847206,
      "rmse_dx": 0.02104962430894375,
      "rmse_dy": 0.010779086500406265,
      "rmse_mean": 0.021523430943489075,
      "rotation_flip": 0.012622720561921597,
      "sparse_tokens": 17213.0,
      "step": 1315,
      "turn_loss": 0.21405690908432007,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.06114105184909868,
      "grad_norm": 0.5904723405838013,
      "learning_rate": 9.752414318623759e-06,
      "loss": 0.1576,
      "mae_dtheta": 0.03607291355729103,
      "mae_dx": 0.01080008689314127,
      "mae_dy": 0.008400625549256802,
      "pose_mae_dtheta": 0.2668246626853943,
      "pose_mae_dx": 0.08560105413198471,
      "pose_mae_dy": 0.08929114043712616,
      "pose_rmse_dtheta": 0.4616911709308624,
      "pose_rmse_dx": 0.18252816796302795,
      "pose_rmse_dy": 0.16129983961582184,
      "pose_rmse_mean": 0.26850640773773193,
      "rmse_dtheta": 0.052325356751680374,
      "rmse_dx": 0.02310061827301979,
      "rmse_dy": 0.015151739120483398,
      "rmse_mean": 0.030192572623491287,
      "rotation_flip": 0.016028495505452156,
      "sparse_tokens": 17981.0,
      "step": 1316,
      "turn_loss": 0.3664524257183075,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06118751161494146,
      "grad_norm": 0.5213241577148438,
      "learning_rate": 9.752003237202663e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.012637708336114883,
      "mae_dx": 0.0026242099702358246,
      "mae_dy": 0.0037563052028417587,
      "pose_mae_dtheta": 0.09296409040689468,
      "pose_mae_dx": 0.0353485532104969,
      "pose_mae_dy": 0.04497704282402992,
      "pose_rmse_dtheta": 0.1887102574110031,
      "pose_rmse_dx": 0.08778835833072662,
      "pose_rmse_dy": 0.10435622185468674,
      "pose_rmse_mean": 0.12695161998271942,
      "rmse_dtheta": 0.02364729344844818,
      "rmse_dx": 0.007432711310684681,
      "rmse_dy": 0.007912933826446533,
      "rmse_mean": 0.012997645884752274,
      "rotation_flip": 0.004465946927666664,
      "sparse_tokens": 32105.0,
      "step": 1317,
      "turn_loss": 0.11047469079494476,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.06123397138078424,
      "grad_norm": 0.6238365769386292,
      "learning_rate": 9.751591823471429e-06,
      "loss": 0.1739,
      "mae_dtheta": 0.03938091918826103,
      "mae_dx": 0.013046909123659134,
      "mae_dy": 0.011356368660926819,
      "pose_mae_dtheta": 0.32066017389297485,
      "pose_mae_dx": 0.124106764793396,
      "pose_mae_dy": 0.12181616574525833,
      "pose_rmse_dtheta": 0.5430716872215271,
      "pose_rmse_dx": 0.2651306092739105,
      "pose_rmse_dy": 0.23395532369613647,
      "pose_rmse_mean": 0.34738588333129883,
      "rmse_dtheta": 0.054329849779605865,
      "rmse_dx": 0.025616159662604332,
      "rmse_dy": 0.016755295917391777,
      "rmse_mean": 0.032233770936727524,
      "rotation_flip": 0.010152284055948257,
      "sparse_tokens": 3112.0,
      "step": 1318,
      "turn_loss": 0.41876718401908875,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06128043114662702,
      "grad_norm": 0.5493347644805908,
      "learning_rate": 9.75118007745883e-06,
      "loss": 0.1445,
      "mae_dtheta": 0.014511620625853539,
      "mae_dx": 0.003406031522899866,
      "mae_dy": 0.0035064485855400562,
      "pose_mae_dtheta": 0.11575793474912643,
      "pose_mae_dx": 0.03706368803977966,
      "pose_mae_dy": 0.04247283563017845,
      "pose_rmse_dtheta": 0.3144581615924835,
      "pose_rmse_dx": 0.12642396986484528,
      "pose_rmse_dy": 0.14019690454006195,
      "pose_rmse_mean": 0.19369302690029144,
      "rmse_dtheta": 0.033378396183252335,
      "rmse_dx": 0.011256815865635872,
      "rmse_dy": 0.010242138989269733,
      "rmse_mean": 0.01829245127737522,
      "rotation_flip": 0.007414272520691156,
      "sparse_tokens": 32073.0,
      "step": 1319,
      "turn_loss": 0.12277786433696747,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.0613268909124698,
      "grad_norm": 0.5688263773918152,
      "learning_rate": 9.750767999193656e-06,
      "loss": 0.1553,
      "mae_dtheta": 0.012296432629227638,
      "mae_dx": 0.0020505471620708704,
      "mae_dy": 0.001846985542215407,
      "pose_mae_dtheta": 0.09186305105686188,
      "pose_mae_dx": 0.025309743359684944,
      "pose_mae_dy": 0.02316705323755741,
      "pose_rmse_dtheta": 0.24483734369277954,
      "pose_rmse_dx": 0.05800653249025345,
      "pose_rmse_dy": 0.06351353228092194,
      "pose_rmse_mean": 0.12211912870407104,
      "rmse_dtheta": 0.027272164821624756,
      "rmse_dx": 0.005131435114890337,
      "rmse_dy": 0.004087614361196756,
      "rmse_mean": 0.012163738720119,
      "rotation_flip": 0.0023427042178809643,
      "sparse_tokens": 32217.0,
      "step": 1320,
      "turn_loss": 0.08746618032455444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.06137335067831258,
      "grad_norm": 1.3482489585876465,
      "learning_rate": 9.750355588704728e-06,
      "loss": 0.3043,
      "mae_dtheta": 0.03383134305477142,
      "mae_dx": 0.00937966164201498,
      "mae_dy": 0.004290025215595961,
      "pose_mae_dtheta": 0.25544413924217224,
      "pose_mae_dx": 0.08456920087337494,
      "pose_mae_dy": 0.06453309208154678,
      "pose_rmse_dtheta": 0.42569661140441895,
      "pose_rmse_dx": 0.2082197517156601,
      "pose_rmse_dy": 0.1285732090473175,
      "pose_rmse_mean": 0.2541632056236267,
      "rmse_dtheta": 0.04974868893623352,
      "rmse_dx": 0.021402938291430473,
      "rmse_dy": 0.00950238574296236,
      "rmse_mean": 0.026884673163294792,
      "rotation_flip": 0.010482179932296276,
      "sparse_tokens": 16084.0,
      "step": 1321,
      "turn_loss": 0.2923835813999176,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 13323.0,
      "epoch": 0.061419810444155364,
      "grad_norm": 0.5853444337844849,
      "learning_rate": 9.749942846020883e-06,
      "loss": 0.1722,
      "mae_dtheta": 0.02032485045492649,
      "mae_dx": 0.005148978438228369,
      "mae_dy": 0.004516540095210075,
      "pose_mae_dtheta": 0.1531534492969513,
      "pose_mae_dx": 0.042988479137420654,
      "pose_mae_dy": 0.06303849816322327,
      "pose_rmse_dtheta": 0.2759624123573303,
      "pose_rmse_dx": 0.12425030022859573,
      "pose_rmse_dy": 0.1272990107536316,
      "pose_rmse_mean": 0.17583724856376648,
      "rmse_dtheta": 0.03557566553354263,
      "rmse_dx": 0.014512792229652405,
      "rmse_dy": 0.008715488016605377,
      "rmse_mean": 0.01960131525993347,
      "rotation_flip": 0.007407407276332378,
      "sparse_tokens": 11340.0,
      "step": 1322,
      "turn_loss": 0.18187478184700012,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.06146627020999814,
      "grad_norm": 0.7301852703094482,
      "learning_rate": 9.749529771170984e-06,
      "loss": 0.2249,
      "mae_dtheta": 0.03875036537647247,
      "mae_dx": 0.012011527083814144,
      "mae_dy": 0.009965136647224426,
      "pose_mae_dtheta": 0.31984958052635193,
      "pose_mae_dx": 0.10055920481681824,
      "pose_mae_dy": 0.12812098860740662,
      "pose_rmse_dtheta": 0.5493192076683044,
      "pose_rmse_dx": 0.19024422764778137,
      "pose_rmse_dy": 0.2758452892303467,
      "pose_rmse_mean": 0.33846959471702576,
      "rmse_dtheta": 0.05553494393825531,
      "rmse_dx": 0.022683821618556976,
      "rmse_dy": 0.017620224505662918,
      "rmse_mean": 0.0319463312625885,
      "rotation_flip": 0.007025761064141989,
      "sparse_tokens": 6849.0,
      "step": 1323,
      "turn_loss": 0.35408565402030945,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.061512729975840924,
      "grad_norm": 0.6006068587303162,
      "learning_rate": 9.749116364183921e-06,
      "loss": 0.1243,
      "mae_dtheta": 0.013565564528107643,
      "mae_dx": 0.003232459304854274,
      "mae_dy": 0.0037688668817281723,
      "pose_mae_dtheta": 0.09817768633365631,
      "pose_mae_dx": 0.035169847309589386,
      "pose_mae_dy": 0.04346342757344246,
      "pose_rmse_dtheta": 0.21646513044834137,
      "pose_rmse_dx": 0.09142991900444031,
      "pose_rmse_dy": 0.11146317422389984,
      "pose_rmse_mean": 0.13978609442710876,
      "rmse_dtheta": 0.025788679718971252,
      "rmse_dx": 0.009512579999864101,
      "rmse_dy": 0.00903596356511116,
      "rmse_mean": 0.014779075048863888,
      "rotation_flip": 0.0035587188322097063,
      "sparse_tokens": 32105.0,
      "step": 1324,
      "turn_loss": 0.1307552605867386,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.0615591897416837,
      "grad_norm": 0.6234856247901917,
      "learning_rate": 9.748702625088601e-06,
      "loss": 0.2088,
      "mae_dtheta": 0.04025273397564888,
      "mae_dx": 0.01157346274703741,
      "mae_dy": 0.007955597713589668,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6234856843948364,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 141.23117065429688,
      "model/head/act_norm_mean": 96.52211626838235,
      "model/head/act_norm_min": 58.69780731201172,
      "model/head/act_over_embed": 66.33090195392217,
      "model/head/grad_frac": 0.10653407126665115,
      "model/head/grad_norm": 0.0664224699139595,
      "model/head/grad_zero_frac": 0.00013325414329301566,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.680078125,
      "model/head/update_ratio": 0.0011564447777345777,
      "model/head/weight_delta": 4.078828811645508,
      "model/head/weight_delta_rel": 0.07155473530292511,
      "model/head/weight_norm": 57.43678283691406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41233009099960327,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4122550875641579,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41217631101608276,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.283305555767028,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1866827756166458,
      "model/modality_embedder.encoders.pose/grad_norm": 0.1163940355181694,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5395848473837209,
      "model/modality_embedder.encoders.pose/update_ratio": 0.003789937822148204,
      "model/modality_embedder.encoders.pose/weight_delta": 1.3064253330230713,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.04268498718738556,
      "model/modality_embedder.encoders.pose/weight_norm": 30.71133041381836,
      "model/modality_embedder/grad_frac": 0.1866827756166458,
      "model/modality_embedder/grad_norm": 0.1163940355181694,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5395848473837209,
      "model/modality_embedder/update_ratio": 0.003789937822148204,
      "model/modality_embedder/weight_delta": 1.3064253330230713,
      "model/modality_embedder/weight_delta_rel": 0.04268498718738556,
      "model/modality_embedder/weight_norm": 30.71133041381836,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.3042221069336,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.140681897759105,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.097053527832031,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.215283884469802,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08331131190061569,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05194341018795967,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001885641016997397,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.7135204076766968,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.026001114398241043,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.546817779541016,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.80140686035156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.014117938842205,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.627483367919922,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.815517309139159,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08664275705814362,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05402052029967308,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018587817903608084,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.8783649802207947,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.030427249148488045,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.06232452392578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.35503387451172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.70751925770308,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.912692070007324,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.97923854933328,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09685912728309631,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.060390278697013855,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00201376061886549,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.9249946475028992,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.031059589236974716,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.988807678222656,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 75.46588897705078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.74469829598506,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.875886917114258,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.379207056811303,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1041683778166771,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06494749337434769,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022081229835748672,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.7883961796760559,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.026943640783429146,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.412986755371094,
      "model/normalizer/grad_frac": 0.4141755700111389,
      "model/normalizer/grad_norm": 0.2582325339317322,
      "model/normalizer/grad_zero_frac": 0.00013826339272782207,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0033165826462209225,
      "model/normalizer/weight_delta": 1.701913833618164,
      "model/normalizer/weight_delta_rel": 0.02191966399550438,
      "model/normalizer/weight_norm": 77.86103057861328,
      "pose_mae_dtheta": 0.3247509002685547,
      "pose_mae_dx": 0.09896659106016159,
      "pose_mae_dy": 0.08902419358491898,
      "pose_rmse_dtheta": 0.5475507378578186,
      "pose_rmse_dx": 0.20187775790691376,
      "pose_rmse_dy": 0.20850969851016998,
      "pose_rmse_mean": 0.3193127512931824,
      "rmse_dtheta": 0.05733185634016991,
      "rmse_dx": 0.021906523033976555,
      "rmse_dy": 0.01715853437781334,
      "rmse_mean": 0.03213230520486832,
      "rotation_flip": 0.01679389365017414,
      "sparse_tokens": 21731.0,
      "step": 1325,
      "turn_loss": 0.3488560914993286,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.061605649507526485,
      "grad_norm": 0.4744150638580322,
      "learning_rate": 9.748288553913958e-06,
      "loss": 0.118,
      "mae_dtheta": 0.017307620495557785,
      "mae_dx": 0.0039011617191135883,
      "mae_dy": 0.005173046607524157,
      "pose_mae_dtheta": 0.1252640336751938,
      "pose_mae_dx": 0.04014912620186806,
      "pose_mae_dy": 0.047489237040281296,
      "pose_rmse_dtheta": 0.27707305550575256,
      "pose_rmse_dx": 0.09022004902362823,
      "pose_rmse_dy": 0.1126621812582016,
      "pose_rmse_mean": 0.15998511016368866,
      "rmse_dtheta": 0.033995792269706726,
      "rmse_dx": 0.010718348436057568,
      "rmse_dy": 0.012059011496603489,
      "rmse_mean": 0.01892438530921936,
      "rotation_flip": 0.008612123318016529,
      "sparse_tokens": 32153.0,
      "step": 1326,
      "turn_loss": 0.1716301292181015,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.06165210927336926,
      "grad_norm": 0.6736404299736023,
      "learning_rate": 9.747874150688948e-06,
      "loss": 0.2155,
      "mae_dtheta": 0.02512630634009838,
      "mae_dx": 0.012121745385229588,
      "mae_dy": 0.005788838490843773,
      "pose_mae_dtheta": 0.19650360941886902,
      "pose_mae_dx": 0.08954348415136337,
      "pose_mae_dy": 0.05810190364718437,
      "pose_rmse_dtheta": 0.3274829685688019,
      "pose_rmse_dx": 0.17621184885501862,
      "pose_rmse_dy": 0.11673754453659058,
      "pose_rmse_mean": 0.20681080222129822,
      "rmse_dtheta": 0.03728758916258812,
      "rmse_dx": 0.022394798696041107,
      "rmse_dy": 0.01128813624382019,
      "rmse_mean": 0.02365684136748314,
      "rotation_flip": 0.012578615918755531,
      "sparse_tokens": 4804.0,
      "step": 1327,
      "turn_loss": 0.23882779479026794,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.061698569039212045,
      "grad_norm": 0.5180997252464294,
      "learning_rate": 9.747459415442548e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.01594245620071888,
      "mae_dx": 0.00277365418151021,
      "mae_dy": 0.0046091098338365555,
      "pose_mae_dtheta": 0.11093227565288544,
      "pose_mae_dx": 0.04304485395550728,
      "pose_mae_dy": 0.049361392855644226,
      "pose_rmse_dtheta": 0.20635901391506195,
      "pose_rmse_dx": 0.09589362889528275,
      "pose_rmse_dy": 0.11202704161405563,
      "pose_rmse_mean": 0.1380932331085205,
      "rmse_dtheta": 0.026627149432897568,
      "rmse_dx": 0.007261385675519705,
      "rmse_dy": 0.008424169383943081,
      "rmse_mean": 0.014104234986007214,
      "rotation_flip": 0.0057575758546590805,
      "sparse_tokens": 32089.0,
      "step": 1328,
      "turn_loss": 0.12770844995975494,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.06174502880505482,
      "grad_norm": 0.5900511145591736,
      "learning_rate": 9.747044348203766e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.03842902556061745,
      "mae_dx": 0.009852509945631027,
      "mae_dy": 0.0059472317807376385,
      "pose_mae_dtheta": 0.30400627851486206,
      "pose_mae_dx": 0.08389285206794739,
      "pose_mae_dy": 0.08333179354667664,
      "pose_rmse_dtheta": 0.5085901618003845,
      "pose_rmse_dx": 0.17214007675647736,
      "pose_rmse_dy": 0.18101510405540466,
      "pose_rmse_mean": 0.2872484624385834,
      "rmse_dtheta": 0.056092239916324615,
      "rmse_dx": 0.02070089429616928,
      "rmse_dy": 0.010564574971795082,
      "rmse_mean": 0.029119236394762993,
      "rotation_flip": 0.016420360654592514,
      "sparse_tokens": 10410.0,
      "step": 1329,
      "turn_loss": 0.32552799582481384,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.061791488570897606,
      "grad_norm": 0.5445638298988342,
      "learning_rate": 9.746628949001624e-06,
      "loss": 0.1276,
      "mae_dtheta": 0.008587867021560669,
      "mae_dx": 0.001608514692634344,
      "mae_dy": 0.0015659581404179335,
      "pose_mae_dtheta": 0.06471141427755356,
      "pose_mae_dx": 0.0199330672621727,
      "pose_mae_dy": 0.021678615361452103,
      "pose_rmse_dtheta": 0.20524653792381287,
      "pose_rmse_dx": 0.07350538671016693,
      "pose_rmse_dy": 0.059564776718616486,
      "pose_rmse_mean": 0.11277222633361816,
      "rmse_dtheta": 0.023363575339317322,
      "rmse_dx": 0.005022749304771423,
      "rmse_dy": 0.004812645260244608,
      "rmse_mean": 0.011066324077546597,
      "rotation_flip": 0.0031277926173061132,
      "sparse_tokens": 32121.0,
      "step": 1330,
      "turn_loss": 0.05791574716567993,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28139.0,
      "epoch": 0.06183794833674038,
      "grad_norm": 0.7706338763237,
      "learning_rate": 9.74621321786517e-06,
      "loss": 0.2243,
      "mae_dtheta": 0.04209984466433525,
      "mae_dx": 0.015245012007653713,
      "mae_dy": 0.006283717695623636,
      "pose_mae_dtheta": 0.35289135575294495,
      "pose_mae_dx": 0.12509475648403168,
      "pose_mae_dy": 0.08891664445400238,
      "pose_rmse_dtheta": 0.5856711268424988,
      "pose_rmse_dx": 0.24731309711933136,
      "pose_rmse_dy": 0.1930895745754242,
      "pose_rmse_mean": 0.34202462434768677,
      "rmse_dtheta": 0.06092917546629906,
      "rmse_dx": 0.02858596295118332,
      "rmse_dy": 0.011663667857646942,
      "rmse_mean": 0.03372626751661301,
      "rotation_flip": 0.007942811585962772,
      "sparse_tokens": 20473.0,
      "step": 1331,
      "turn_loss": 0.311681866645813,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.061884408102583166,
      "grad_norm": 0.6579782962799072,
      "learning_rate": 9.74579715482348e-06,
      "loss": 0.1694,
      "mae_dtheta": 0.035028208047151566,
      "mae_dx": 0.011672123335301876,
      "mae_dy": 0.004778702277690172,
      "pose_mae_dtheta": 0.2617962062358856,
      "pose_mae_dx": 0.10233449935913086,
      "pose_mae_dy": 0.05178321152925491,
      "pose_rmse_dtheta": 0.42350584268569946,
      "pose_rmse_dx": 0.21585014462471008,
      "pose_rmse_dy": 0.10427340865135193,
      "pose_rmse_mean": 0.24787649512290955,
      "rmse_dtheta": 0.052780549973249435,
      "rmse_dx": 0.023212889209389687,
      "rmse_dy": 0.009098845534026623,
      "rmse_mean": 0.028364095836877823,
      "rotation_flip": 0.018939394503831863,
      "sparse_tokens": 4828.0,
      "step": 1332,
      "turn_loss": 0.27953922748565674,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 11379.0,
      "epoch": 0.06193086786842594,
      "grad_norm": 0.6320741176605225,
      "learning_rate": 9.745380759905648e-06,
      "loss": 0.1426,
      "mae_dtheta": 0.02488279901444912,
      "mae_dx": 0.012575576081871986,
      "mae_dy": 0.001808810862712562,
      "pose_mae_dtheta": 0.18542149662971497,
      "pose_mae_dx": 0.09439574182033539,
      "pose_mae_dy": 0.017324041575193405,
      "pose_rmse_dtheta": 0.3627353310585022,
      "pose_rmse_dx": 0.24355526268482208,
      "pose_rmse_dy": 0.036537736654281616,
      "pose_rmse_mean": 0.21427612006664276,
      "rmse_dtheta": 0.041581857949495316,
      "rmse_dx": 0.026429932564496994,
      "rmse_dy": 0.004532712046056986,
      "rmse_mean": 0.02418150007724762,
      "rotation_flip": 0.017582418397068977,
      "sparse_tokens": 8423.0,
      "step": 1333,
      "turn_loss": 0.16356995701789856,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.06197732763426873,
      "grad_norm": 0.6634095311164856,
      "learning_rate": 9.744964033140791e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.026317792013287544,
      "mae_dx": 0.013670804910361767,
      "mae_dy": 0.007845868356525898,
      "pose_mae_dtheta": 0.18556952476501465,
      "pose_mae_dx": 0.109840027987957,
      "pose_mae_dy": 0.11075249314308167,
      "pose_rmse_dtheta": 0.3732072710990906,
      "pose_rmse_dx": 0.22131098806858063,
      "pose_rmse_dy": 0.22295022010803223,
      "pose_rmse_mean": 0.2724894881248474,
      "rmse_dtheta": 0.04069472849369049,
      "rmse_dx": 0.026482563465833664,
      "rmse_dy": 0.01331799291074276,
      "rmse_mean": 0.026831764727830887,
      "rotation_flip": 0.010498687624931335,
      "sparse_tokens": 7061.0,
      "step": 1334,
      "turn_loss": 0.2646818459033966,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.0620237874001115,
      "grad_norm": 0.6138641238212585,
      "learning_rate": 9.744546974558054e-06,
      "loss": 0.1425,
      "mae_dtheta": 0.039148591458797455,
      "mae_dx": 0.010912330821156502,
      "mae_dy": 0.0029234085232019424,
      "pose_mae_dtheta": 0.3218946158885956,
      "pose_mae_dx": 0.08136207610368729,
      "pose_mae_dy": 0.0531277135014534,
      "pose_rmse_dtheta": 0.5246193408966064,
      "pose_rmse_dx": 0.1604086309671402,
      "pose_rmse_dy": 0.13010849058628082,
      "pose_rmse_mean": 0.27171215415000916,
      "rmse_dtheta": 0.05837853625416756,
      "rmse_dx": 0.021029509603977203,
      "rmse_dy": 0.005983632057905197,
      "rmse_mean": 0.028463896363973618,
      "rotation_flip": 0.009756097570061684,
      "sparse_tokens": 6855.0,
      "step": 1335,
      "turn_loss": 0.29396650195121765,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 24339.0,
      "epoch": 0.06207024716595429,
      "grad_norm": 0.5368362665176392,
      "learning_rate": 9.744129584186599e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.03507272154092789,
      "mae_dx": 0.009210417978465557,
      "mae_dy": 0.004306931979954243,
      "pose_mae_dtheta": 0.2773326635360718,
      "pose_mae_dx": 0.0782325267791748,
      "pose_mae_dy": 0.05919435992836952,
      "pose_rmse_dtheta": 0.5252867341041565,
      "pose_rmse_dx": 0.19447734951972961,
      "pose_rmse_dy": 0.130902960896492,
      "pose_rmse_mean": 0.28355568647384644,
      "rmse_dtheta": 0.055198948830366135,
      "rmse_dx": 0.021022578701376915,
      "rmse_dy": 0.007902341894805431,
      "rmse_mean": 0.028041288256645203,
      "rotation_flip": 0.010160880163311958,
      "sparse_tokens": 18536.0,
      "step": 1336,
      "turn_loss": 0.2377305030822754,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.062116706931797064,
      "grad_norm": 0.7584519982337952,
      "learning_rate": 9.743711862055617e-06,
      "loss": 0.1996,
      "mae_dtheta": 0.04251454025506973,
      "mae_dx": 0.017582198604941368,
      "mae_dy": 0.0213248860090971,
      "pose_mae_dtheta": 0.37045425176620483,
      "pose_mae_dx": 0.13789115846157074,
      "pose_mae_dy": 0.23975451290607452,
      "pose_rmse_dtheta": 0.6523230671882629,
      "pose_rmse_dx": 0.26267674565315247,
      "pose_rmse_dy": 0.4194581210613251,
      "pose_rmse_mean": 0.4448193311691284,
      "rmse_dtheta": 0.06430524587631226,
      "rmse_dx": 0.030410991981625557,
      "rmse_dy": 0.03382675349712372,
      "rmse_mean": 0.042847663164138794,
      "rotation_flip": 0.014144271612167358,
      "sparse_tokens": 12145.0,
      "step": 1337,
      "turn_loss": 0.5514719486236572,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06216316669763984,
      "grad_norm": 0.6654105186462402,
      "learning_rate": 9.743293808194318e-06,
      "loss": 0.1523,
      "mae_dtheta": 0.01055761706084013,
      "mae_dx": 0.002756164874881506,
      "mae_dy": 0.003683272283524275,
      "pose_mae_dtheta": 0.07019495218992233,
      "pose_mae_dx": 0.032351233065128326,
      "pose_mae_dy": 0.0360761396586895,
      "pose_rmse_dtheta": 0.1393481343984604,
      "pose_rmse_dx": 0.08201222866773605,
      "pose_rmse_dy": 0.08790053427219391,
      "pose_rmse_mean": 0.10308697074651718,
      "rmse_dtheta": 0.02128688432276249,
      "rmse_dx": 0.00810290314257145,
      "rmse_dy": 0.008837021887302399,
      "rmse_mean": 0.012742269784212112,
      "rotation_flip": 0.005301022436469793,
      "sparse_tokens": 32105.0,
      "step": 1338,
      "turn_loss": 0.11237410455942154,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.062209626463482624,
      "grad_norm": 0.5839018821716309,
      "learning_rate": 9.742875422631937e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.010752732865512371,
      "mae_dx": 0.0017804813105612993,
      "mae_dy": 0.0012381917331367731,
      "pose_mae_dtheta": 0.07791290432214737,
      "pose_mae_dx": 0.01816386915743351,
      "pose_mae_dy": 0.02154638059437275,
      "pose_rmse_dtheta": 0.22544249892234802,
      "pose_rmse_dx": 0.04600107669830322,
      "pose_rmse_dy": 0.05232851207256317,
      "pose_rmse_mean": 0.10792402923107147,
      "rmse_dtheta": 0.026878314092755318,
      "rmse_dx": 0.005235650110989809,
      "rmse_dy": 0.0025821712333709,
      "rmse_mean": 0.011565378867089748,
      "rotation_flip": 0.003352490486577153,
      "sparse_tokens": 32121.0,
      "step": 1339,
      "turn_loss": 0.060338426381349564,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.0622560862293254,
      "grad_norm": 0.6866992115974426,
      "learning_rate": 9.742456705397732e-06,
      "loss": 0.2003,
      "mae_dtheta": 0.030419791117310524,
      "mae_dx": 0.026413647457957268,
      "mae_dy": 0.015147095546126366,
      "pose_mae_dtheta": 0.2709098160266876,
      "pose_mae_dx": 0.19083839654922485,
      "pose_mae_dy": 0.10265297442674637,
      "pose_rmse_dtheta": 0.47331467270851135,
      "pose_rmse_dx": 0.3532068431377411,
      "pose_rmse_dy": 0.2252606749534607,
      "pose_rmse_mean": 0.35059404373168945,
      "rmse_dtheta": 0.04875340685248375,
      "rmse_dx": 0.04037469998002052,
      "rmse_dy": 0.027546262368559837,
      "rmse_mean": 0.03889145702123642,
      "rotation_flip": 0.0,
      "sparse_tokens": 3205.0,
      "step": 1340,
      "turn_loss": 0.594618022441864,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.062302545995168185,
      "grad_norm": 0.4404065012931824,
      "learning_rate": 9.742037656520984e-06,
      "loss": 0.082,
      "mae_dtheta": 0.013058886863291264,
      "mae_dx": 0.002034388482570648,
      "mae_dy": 0.0027543031610548496,
      "pose_mae_dtheta": 0.08740738779306412,
      "pose_mae_dx": 0.02860439196228981,
      "pose_mae_dy": 0.032031092792749405,
      "pose_rmse_dtheta": 0.21016472578048706,
      "pose_rmse_dx": 0.06966254115104675,
      "pose_rmse_dy": 0.06885768473148346,
      "pose_rmse_mean": 0.11622832715511322,
      "rmse_dtheta": 0.025471655651926994,
      "rmse_dx": 0.006029181648045778,
      "rmse_dy": 0.00524569908156991,
      "rmse_mean": 0.01224884670227766,
      "rotation_flip": 0.006618133746087551,
      "sparse_tokens": 32105.0,
      "step": 1341,
      "turn_loss": 0.10093042254447937,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.06234900576101096,
      "grad_norm": 0.569220244884491,
      "learning_rate": 9.741618276030998e-06,
      "loss": 0.0978,
      "mae_dtheta": 0.007752449717372656,
      "mae_dx": 0.002076420933008194,
      "mae_dy": 0.0010857569286599755,
      "pose_mae_dtheta": 0.060708194971084595,
      "pose_mae_dx": 0.02261890470981598,
      "pose_mae_dy": 0.017108501866459846,
      "pose_rmse_dtheta": 0.20309093594551086,
      "pose_rmse_dx": 0.07389654964208603,
      "pose_rmse_dy": 0.05590446665883064,
      "pose_rmse_mean": 0.11096399277448654,
      "rmse_dtheta": 0.021704407408833504,
      "rmse_dx": 0.0074232653714716434,
      "rmse_dy": 0.003174729645252228,
      "rmse_mean": 0.010767467319965363,
      "rotation_flip": 0.002597402548417449,
      "sparse_tokens": 32057.0,
      "step": 1342,
      "turn_loss": 0.06433875858783722,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.062395465526853745,
      "grad_norm": 0.6225083470344543,
      "learning_rate": 9.7411985639571e-06,
      "loss": 0.163,
      "mae_dtheta": 0.015465687029063702,
      "mae_dx": 0.004188960418105125,
      "mae_dy": 0.004447708372026682,
      "pose_mae_dtheta": 0.11295191198587418,
      "pose_mae_dx": 0.04978740215301514,
      "pose_mae_dy": 0.048261821269989014,
      "pose_rmse_dtheta": 0.2500752806663513,
      "pose_rmse_dx": 0.13538658618927002,
      "pose_rmse_dy": 0.13006867468357086,
      "pose_rmse_mean": 0.1718435138463974,
      "rmse_dtheta": 0.030561141669750214,
      "rmse_dx": 0.011622129008173943,
      "rmse_dy": 0.010096783749759197,
      "rmse_mean": 0.017426686361432076,
      "rotation_flip": 0.006559527944773436,
      "sparse_tokens": 32169.0,
      "step": 1343,
      "turn_loss": 0.16286413371562958,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.06244192529269652,
      "grad_norm": 0.6601397395133972,
      "learning_rate": 9.740778520328643e-06,
      "loss": 0.1675,
      "mae_dtheta": 0.04387115687131882,
      "mae_dx": 0.008687089197337627,
      "mae_dy": 0.004814707208424807,
      "pose_mae_dtheta": 0.39945876598358154,
      "pose_mae_dx": 0.07204234600067139,
      "pose_mae_dy": 0.03452546149492264,
      "pose_rmse_dtheta": 0.6303466558456421,
      "pose_rmse_dx": 0.14044217765331268,
      "pose_rmse_dy": 0.08426792919635773,
      "pose_rmse_mean": 0.2850189208984375,
      "rmse_dtheta": 0.06267092376947403,
      "rmse_dx": 0.017526457086205482,
      "rmse_dy": 0.009081248193979263,
      "rmse_mean": 0.029759541153907776,
      "rotation_flip": 0.024077046662569046,
      "sparse_tokens": 9631.0,
      "step": 1344,
      "turn_loss": 0.3545854985713959,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.062488385058539306,
      "grad_norm": 0.5020618438720703,
      "learning_rate": 9.740358145174999e-06,
      "loss": 0.1233,
      "mae_dtheta": 0.005605383776128292,
      "mae_dx": 0.0010320774745196104,
      "mae_dy": 0.0009023266029544175,
      "pose_mae_dtheta": 0.04193582385778427,
      "pose_mae_dx": 0.012483256869018078,
      "pose_mae_dy": 0.01699076220393181,
      "pose_rmse_dtheta": 0.11982907354831696,
      "pose_rmse_dx": 0.03788589686155319,
      "pose_rmse_dy": 0.049146123230457306,
      "pose_rmse_mean": 0.06895369291305542,
      "rmse_dtheta": 0.01658579707145691,
      "rmse_dx": 0.003567703301087022,
      "rmse_dy": 0.002435398520901799,
      "rmse_mean": 0.007529633119702339,
      "rotation_flip": 0.0021276595070958138,
      "sparse_tokens": 32057.0,
      "step": 1345,
      "turn_loss": 0.04256690293550491,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.06253484482438208,
      "grad_norm": 0.5558420419692993,
      "learning_rate": 9.739937438525565e-06,
      "loss": 0.1438,
      "mae_dtheta": 0.010379701852798462,
      "mae_dx": 0.0035400267224758863,
      "mae_dy": 0.002357975346967578,
      "pose_mae_dtheta": 0.07848496735095978,
      "pose_mae_dx": 0.041540540754795074,
      "pose_mae_dy": 0.03589817136526108,
      "pose_rmse_dtheta": 0.17984037101268768,
      "pose_rmse_dx": 0.13545319437980652,
      "pose_rmse_dy": 0.08798782527446747,
      "pose_rmse_mean": 0.13442713022232056,
      "rmse_dtheta": 0.022698989138007164,
      "rmse_dx": 0.012491072528064251,
      "rmse_dy": 0.0057119629345834255,
      "rmse_mean": 0.013634007424116135,
      "rotation_flip": 0.003218884114176035,
      "sparse_tokens": 32041.0,
      "step": 1346,
      "turn_loss": 0.11528913676738739,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.06258130459022486,
      "grad_norm": 1.1358637809753418,
      "learning_rate": 9.739516400409761e-06,
      "loss": 0.2872,
      "mae_dtheta": 0.04601611569523811,
      "mae_dx": 0.006921820808202028,
      "mae_dy": 0.0038448148407042027,
      "pose_mae_dtheta": 0.3607387840747833,
      "pose_mae_dx": 0.0584663450717926,
      "pose_mae_dy": 0.05315248668193817,
      "pose_rmse_dtheta": 0.6436114311218262,
      "pose_rmse_dx": 0.13291309773921967,
      "pose_rmse_dy": 0.1401468962430954,
      "pose_rmse_mean": 0.30555716156959534,
      "rmse_dtheta": 0.0684557631611824,
      "rmse_dx": 0.016120243817567825,
      "rmse_dy": 0.009614870883524418,
      "rmse_mean": 0.03139696270227432,
      "rotation_flip": 0.015978695824742317,
      "sparse_tokens": 11427.0,
      "step": 1347,
      "turn_loss": 0.30399996042251587,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06262776435606765,
      "grad_norm": 0.4930914044380188,
      "learning_rate": 9.739095030857033e-06,
      "loss": 0.1336,
      "mae_dtheta": 0.011726086027920246,
      "mae_dx": 0.002512444742023945,
      "mae_dy": 0.0027291756123304367,
      "pose_mae_dtheta": 0.08378292620182037,
      "pose_mae_dx": 0.03412913158535957,
      "pose_mae_dy": 0.03565239906311035,
      "pose_rmse_dtheta": 0.20578354597091675,
      "pose_rmse_dx": 0.08524677902460098,
      "pose_rmse_dy": 0.08828197419643402,
      "pose_rmse_mean": 0.12643742561340332,
      "rmse_dtheta": 0.025605466216802597,
      "rmse_dx": 0.007424259092658758,
      "rmse_dy": 0.005993973929435015,
      "rmse_mean": 0.01300789974629879,
      "rotation_flip": 0.005602241028100252,
      "sparse_tokens": 32073.0,
      "step": 1348,
      "turn_loss": 0.10559012740850449,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06267422412191043,
      "grad_norm": 0.5104542970657349,
      "learning_rate": 9.738673329896846e-06,
      "loss": 0.1032,
      "mae_dtheta": 0.011861508712172508,
      "mae_dx": 0.0025074626319110394,
      "mae_dy": 0.0036081376019865274,
      "pose_mae_dtheta": 0.08079668879508972,
      "pose_mae_dx": 0.03610626235604286,
      "pose_mae_dy": 0.039619818329811096,
      "pose_rmse_dtheta": 0.16518627107143402,
      "pose_rmse_dx": 0.09444137662649155,
      "pose_rmse_dy": 0.09614301472902298,
      "pose_rmse_mean": 0.11859022080898285,
      "rmse_dtheta": 0.02328232303261757,
      "rmse_dx": 0.0067257871851325035,
      "rmse_dy": 0.007632911670953035,
      "rmse_mean": 0.012547007761895657,
      "rotation_flip": 0.00467107817530632,
      "sparse_tokens": 32073.0,
      "step": 1349,
      "turn_loss": 0.1102418452501297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0627206838877532,
      "grad_norm": 0.41139769554138184,
      "learning_rate": 9.738251297558689e-06,
      "loss": 0.1132,
      "mae_dtheta": 0.010823674499988556,
      "mae_dx": 0.0015516200801357627,
      "mae_dy": 0.0018685230752453208,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4113975763320923,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.59727478027344,
      "model/head/act_norm_mean": 121.35515309343434,
      "model/head/act_norm_min": 72.00968933105469,
      "model/head/act_over_embed": 83.3963973506516,
      "model/head/grad_frac": 0.11083325743675232,
      "model/head/grad_norm": 0.04559653252363205,
      "model/head/grad_zero_frac": 0.00020083303388673812,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6864938446969697,
      "model/head/update_ratio": 0.000793745624832809,
      "model/head/weight_delta": 4.1173810958862305,
      "model/head/weight_delta_rel": 0.07223106175661087,
      "model/head/weight_norm": 57.444766998291016,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4122450053691864,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4121855999010181,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41212713718414307,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28325780319436455,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09072437137365341,
      "model/modality_embedder.encoders.pose/grad_norm": 0.037323787808418274,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5138486283936652,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012152186827734113,
      "model/modality_embedder.encoders.pose/weight_delta": 1.3183902502059937,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.04307591915130615,
      "model/modality_embedder.encoders.pose/weight_norm": 30.713638305664062,
      "model/modality_embedder/grad_frac": 0.09072437137365341,
      "model/modality_embedder/grad_norm": 0.037323787808418274,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5138486283936652,
      "model/modality_embedder/update_ratio": 0.0012152186827734113,
      "model/modality_embedder/weight_delta": 1.3183902502059937,
      "model/modality_embedder/weight_delta_rel": 0.04307591915130615,
      "model/modality_embedder/weight_norm": 30.713638305664062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.96823120117188,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.477017195767196,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.942200660705566,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.82083537437664,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09650158137083054,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03970051556825638,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014411242445930839,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.7255257368087769,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.026438595727086067,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.548294067382812,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.43463134765625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.556171837421836,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.055594444274902,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.56244054732664,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09028251469135284,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.037142008543014526,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012778586242347956,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.8923225998878479,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.030910752713680267,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.065820693969727,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.35102844238281,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.485983345358346,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.02391242980957,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.8886250827606,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09851597994565964,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04052923619747162,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013513077283278108,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.9407855868339539,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0315898172557354,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.992603302001953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.99475860595703,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.33862433862434,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.524821281433105,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.16177731803124,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12422750145196915,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05110689252614975,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017374013550579548,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.8025851845741272,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.027428552508354187,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.415708541870117,
      "model/normalizer/grad_frac": 0.4677341878414154,
      "model/normalizer/grad_norm": 0.1924247145652771,
      "model/normalizer/grad_zero_frac": 0.00018671466386877,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0024712609592825174,
      "model/normalizer/weight_delta": 1.7306005954742432,
      "model/normalizer/weight_delta_rel": 0.022289134562015533,
      "model/normalizer/weight_norm": 77.864990234375,
      "pose_mae_dtheta": 0.0835026353597641,
      "pose_mae_dx": 0.018962617963552475,
      "pose_mae_dy": 0.029608864337205887,
      "pose_rmse_dtheta": 0.22698259353637695,
      "pose_rmse_dx": 0.04976332187652588,
      "pose_rmse_dy": 0.0830300897359848,
      "pose_rmse_mean": 0.11992534250020981,
      "rmse_dtheta": 0.02616778388619423,
      "rmse_dx": 0.004858986474573612,
      "rmse_dy": 0.004240571986883879,
      "rmse_mean": 0.01175578124821186,
      "rotation_flip": 0.006432459224015474,
      "sparse_tokens": 32089.0,
      "step": 1350,
      "turn_loss": 0.07844305783510208,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.06276714365359598,
      "grad_norm": 0.40411773324012756,
      "learning_rate": 9.737828933872076e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.011562000960111618,
      "mae_dx": 0.0014806855469942093,
      "mae_dy": 0.0021439515985548496,
      "pose_mae_dtheta": 0.07659433037042618,
      "pose_mae_dx": 0.024116845801472664,
      "pose_mae_dy": 0.028460148721933365,
      "pose_rmse_dtheta": 0.20052623748779297,
      "pose_rmse_dx": 0.05587899312376976,
      "pose_rmse_dy": 0.061488352715969086,
      "pose_rmse_mean": 0.1059645339846611,
      "rmse_dtheta": 0.025198569521307945,
      "rmse_dx": 0.004550733603537083,
      "rmse_dy": 0.004205287899821997,
      "rmse_mean": 0.011318197473883629,
      "rotation_flip": 0.006296733394265175,
      "sparse_tokens": 32089.0,
      "step": 1351,
      "turn_loss": 0.08776206523180008,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.06281360341943877,
      "grad_norm": 0.680899441242218,
      "learning_rate": 9.737406238866543e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.014261485077440739,
      "mae_dx": 0.002430953085422516,
      "mae_dy": 0.0038427370600402355,
      "pose_mae_dtheta": 0.09888359159231186,
      "pose_mae_dx": 0.03452015668153763,
      "pose_mae_dy": 0.04616270586848259,
      "pose_rmse_dtheta": 0.21780481934547424,
      "pose_rmse_dx": 0.09206028282642365,
      "pose_rmse_dy": 0.11048942804336548,
      "pose_rmse_mean": 0.14011818170547485,
      "rmse_dtheta": 0.027421901002526283,
      "rmse_dx": 0.007566428743302822,
      "rmse_dy": 0.008540085516870022,
      "rmse_mean": 0.0145094720646739,
      "rotation_flip": 0.004569687880575657,
      "sparse_tokens": 32041.0,
      "step": 1352,
      "turn_loss": 0.1310325264930725,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33311.0,
      "epoch": 0.06286006318528155,
      "grad_norm": 0.5779243111610413,
      "learning_rate": 9.736983212571646e-06,
      "loss": 0.1987,
      "mae_dtheta": 0.03284839540719986,
      "mae_dx": 0.013572992756962776,
      "mae_dy": 0.005615314934402704,
      "pose_mae_dtheta": 0.265078604221344,
      "pose_mae_dx": 0.10692723095417023,
      "pose_mae_dy": 0.07069713622331619,
      "pose_rmse_dtheta": 0.48364442586898804,
      "pose_rmse_dx": 0.23632828891277313,
      "pose_rmse_dy": 0.15948665142059326,
      "pose_rmse_mean": 0.29315313696861267,
      "rmse_dtheta": 0.05135197192430496,
      "rmse_dx": 0.02700580097734928,
      "rmse_dy": 0.011063314974308014,
      "rmse_mean": 0.02980702929198742,
      "rotation_flip": 0.015699658542871475,
      "sparse_tokens": 26783.0,
      "step": 1353,
      "turn_loss": 0.29627725481987,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.06290652295112432,
      "grad_norm": 0.6684587001800537,
      "learning_rate": 9.736559855016974e-06,
      "loss": 0.1633,
      "mae_dtheta": 0.01772787980735302,
      "mae_dx": 0.010791011154651642,
      "mae_dy": 0.0040017906576395035,
      "pose_mae_dtheta": 0.11144667863845825,
      "pose_mae_dx": 0.08052486181259155,
      "pose_mae_dy": 0.06797916442155838,
      "pose_rmse_dtheta": 0.18237873911857605,
      "pose_rmse_dx": 0.2052992582321167,
      "pose_rmse_dy": 0.1487002968788147,
      "pose_rmse_mean": 0.17879275977611542,
      "rmse_dtheta": 0.028356973081827164,
      "rmse_dx": 0.023838279768824577,
      "rmse_dy": 0.007875586859881878,
      "rmse_mean": 0.020023614168167114,
      "rotation_flip": 0.013651876710355282,
      "sparse_tokens": 5857.0,
      "step": 1354,
      "turn_loss": 0.1446152776479721,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.0629529827169671,
      "grad_norm": 0.44025179743766785,
      "learning_rate": 9.736136166232128e-06,
      "loss": 0.102,
      "mae_dtheta": 0.00903163943439722,
      "mae_dx": 0.001960801426321268,
      "mae_dy": 0.0016195966163650155,
      "pose_mae_dtheta": 0.06779813021421432,
      "pose_mae_dx": 0.021926846355199814,
      "pose_mae_dy": 0.02164197526872158,
      "pose_rmse_dtheta": 0.1698145568370819,
      "pose_rmse_dx": 0.05176466330885887,
      "pose_rmse_dy": 0.050436604768037796,
      "pose_rmse_mean": 0.09067194908857346,
      "rmse_dtheta": 0.021864237263798714,
      "rmse_dx": 0.005647155921906233,
      "rmse_dy": 0.003873562440276146,
      "rmse_mean": 0.010461652651429176,
      "rotation_flip": 0.00394045514985919,
      "sparse_tokens": 32153.0,
      "step": 1355,
      "turn_loss": 0.07523052394390106,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.06299944248280989,
      "grad_norm": 0.5731526017189026,
      "learning_rate": 9.735712146246737e-06,
      "loss": 0.1641,
      "mae_dtheta": 0.031580083072185516,
      "mae_dx": 0.007260266225785017,
      "mae_dy": 0.00498651247471571,
      "pose_mae_dtheta": 0.2899164855480194,
      "pose_mae_dx": 0.08403339236974716,
      "pose_mae_dy": 0.08494165539741516,
      "pose_rmse_dtheta": 0.5207583904266357,
      "pose_rmse_dx": 0.2212279587984085,
      "pose_rmse_dy": 0.16998203098773956,
      "pose_rmse_mean": 0.3039894700050354,
      "rmse_dtheta": 0.051038097590208054,
      "rmse_dx": 0.019609108567237854,
      "rmse_dy": 0.00940632913261652,
      "rmse_mean": 0.026684513315558434,
      "rotation_flip": 0.008356546051800251,
      "sparse_tokens": 6897.0,
      "step": 1356,
      "turn_loss": 0.24185696244239807,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.06304590224865267,
      "grad_norm": 0.6128315925598145,
      "learning_rate": 9.735287795090455e-06,
      "loss": 0.1114,
      "mae_dtheta": 0.04346226528286934,
      "mae_dx": 0.005934600718319416,
      "mae_dy": 0.0024123985785990953,
      "pose_mae_dtheta": 0.3567410111427307,
      "pose_mae_dx": 0.04489174112677574,
      "pose_mae_dy": 0.02617240510880947,
      "pose_rmse_dtheta": 0.5986940264701843,
      "pose_rmse_dx": 0.11044485121965408,
      "pose_rmse_dy": 0.0671599954366684,
      "pose_rmse_mean": 0.2587662935256958,
      "rmse_dtheta": 0.06711019575595856,
      "rmse_dx": 0.01372757088392973,
      "rmse_dy": 0.00517427921295166,
      "rmse_mean": 0.02867068164050579,
      "rotation_flip": 0.011450381949543953,
      "sparse_tokens": 4828.0,
      "step": 1357,
      "turn_loss": 0.2283622920513153,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 34388.0,
      "epoch": 0.06309236201449545,
      "grad_norm": 0.5080516338348389,
      "learning_rate": 9.734863112792956e-06,
      "loss": 0.1505,
      "mae_dtheta": 0.025388365611433983,
      "mae_dx": 0.007673355285078287,
      "mae_dy": 0.005079674534499645,
      "pose_mae_dtheta": 0.1868523210287094,
      "pose_mae_dx": 0.061489351093769073,
      "pose_mae_dy": 0.062254760414361954,
      "pose_rmse_dtheta": 0.33375874161720276,
      "pose_rmse_dx": 0.1483936756849289,
      "pose_rmse_dy": 0.1309218555688858,
      "pose_rmse_mean": 0.2043580859899521,
      "rmse_dtheta": 0.040324002504348755,
      "rmse_dx": 0.017882507294416428,
      "rmse_dy": 0.010091908276081085,
      "rmse_mean": 0.02276613935828209,
      "rotation_flip": 0.009723260998725891,
      "sparse_tokens": 27379.0,
      "step": 1358,
      "turn_loss": 0.23438382148742676,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.06313882178033822,
      "grad_norm": 0.5710929036140442,
      "learning_rate": 9.734438099383938e-06,
      "loss": 0.1543,
      "mae_dtheta": 0.010847555473446846,
      "mae_dx": 0.001624796655960381,
      "mae_dy": 0.002416127361357212,
      "pose_mae_dtheta": 0.07148384302854538,
      "pose_mae_dx": 0.02277996391057968,
      "pose_mae_dy": 0.027973420917987823,
      "pose_rmse_dtheta": 0.1680985391139984,
      "pose_rmse_dx": 0.05661889910697937,
      "pose_rmse_dy": 0.062161799520254135,
      "pose_rmse_mean": 0.09562641382217407,
      "rmse_dtheta": 0.023368455469608307,
      "rmse_dx": 0.004723452962934971,
      "rmse_dy": 0.005268624052405357,
      "rmse_mean": 0.011120177805423737,
      "rotation_flip": 0.0024400162510573864,
      "sparse_tokens": 32089.0,
      "step": 1359,
      "turn_loss": 0.08527527749538422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11346.0,
      "epoch": 0.06318528154618101,
      "grad_norm": 0.592343270778656,
      "learning_rate": 9.734012754893121e-06,
      "loss": 0.1718,
      "mae_dtheta": 0.04331185668706894,
      "mae_dx": 0.014170235022902489,
      "mae_dy": 0.006532086059451103,
      "pose_mae_dtheta": 0.34710079431533813,
      "pose_mae_dx": 0.11027608811855316,
      "pose_mae_dy": 0.06516429036855698,
      "pose_rmse_dtheta": 0.5732643604278564,
      "pose_rmse_dx": 0.23119759559631348,
      "pose_rmse_dy": 0.15097878873348236,
      "pose_rmse_mean": 0.3184802532196045,
      "rmse_dtheta": 0.06160493195056915,
      "rmse_dx": 0.02693415805697441,
      "rmse_dy": 0.013578973710536957,
      "rmse_mean": 0.03403935581445694,
      "rotation_flip": 0.008561643771827221,
      "sparse_tokens": 8968.0,
      "step": 1360,
      "turn_loss": 0.3630548119544983,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.06323174131202379,
      "grad_norm": 0.8113961219787598,
      "learning_rate": 9.733587079350254e-06,
      "loss": 0.3465,
      "mae_dtheta": 0.03848779574036598,
      "mae_dx": 0.011781428940594196,
      "mae_dy": 0.0017752452986314893,
      "pose_mae_dtheta": 0.302375853061676,
      "pose_mae_dx": 0.09174632281064987,
      "pose_mae_dy": 0.014860603958368301,
      "pose_rmse_dtheta": 0.5262339115142822,
      "pose_rmse_dx": 0.22387954592704773,
      "pose_rmse_dy": 0.0349210649728775,
      "pose_rmse_mean": 0.26167818903923035,
      "rmse_dtheta": 0.05939962714910507,
      "rmse_dx": 0.023877624422311783,
      "rmse_dy": 0.00420768465846777,
      "rmse_mean": 0.029161646962165833,
      "rotation_flip": 0.017456358298659325,
      "sparse_tokens": 6438.0,
      "step": 1361,
      "turn_loss": 0.27043595910072327,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.06327820107786657,
      "grad_norm": 0.7014685273170471,
      "learning_rate": 9.7331610727851e-06,
      "loss": 0.1453,
      "mae_dtheta": 0.05265691503882408,
      "mae_dx": 0.014636478386819363,
      "mae_dy": 0.004091733135282993,
      "pose_mae_dtheta": 0.4522562026977539,
      "pose_mae_dx": 0.10934405773878098,
      "pose_mae_dy": 0.048149242997169495,
      "pose_rmse_dtheta": 0.6714622378349304,
      "pose_rmse_dx": 0.2170880287885666,
      "pose_rmse_dy": 0.12217597663402557,
      "pose_rmse_mean": 0.336908757686615,
      "rmse_dtheta": 0.06904835253953934,
      "rmse_dx": 0.026324599981307983,
      "rmse_dy": 0.008750812150537968,
      "rmse_mean": 0.034707922488451004,
      "rotation_flip": 0.01173020526766777,
      "sparse_tokens": 10966.0,
      "step": 1362,
      "turn_loss": 0.3568498194217682,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.06332466084370934,
      "grad_norm": 0.6850477457046509,
      "learning_rate": 9.73273473522745e-06,
      "loss": 0.1283,
      "mae_dtheta": 0.012420094572007656,
      "mae_dx": 0.0027628762181848288,
      "mae_dy": 0.0031630697194486856,
      "pose_mae_dtheta": 0.08494801819324493,
      "pose_mae_dx": 0.03306778520345688,
      "pose_mae_dy": 0.03509994223713875,
      "pose_rmse_dtheta": 0.1878376305103302,
      "pose_rmse_dx": 0.0779222771525383,
      "pose_rmse_dy": 0.08461379259824753,
      "pose_rmse_mean": 0.1167912408709526,
      "rmse_dtheta": 0.02523631975054741,
      "rmse_dx": 0.007424855604767799,
      "rmse_dy": 0.007042149547487497,
      "rmse_mean": 0.01323444303125143,
      "rotation_flip": 0.007521255873143673,
      "sparse_tokens": 32169.0,
      "step": 1363,
      "turn_loss": 0.09517232328653336,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.06337112060955213,
      "grad_norm": 0.7953899502754211,
      "learning_rate": 9.732308066707123e-06,
      "loss": 0.2263,
      "mae_dtheta": 0.04158881679177284,
      "mae_dx": 0.015346228145062923,
      "mae_dy": 0.0057407524436712265,
      "pose_mae_dtheta": 0.3624463975429535,
      "pose_mae_dx": 0.10765266418457031,
      "pose_mae_dy": 0.08589605987071991,
      "pose_rmse_dtheta": 0.6209085583686829,
      "pose_rmse_dx": 0.2326277792453766,
      "pose_rmse_dy": 0.20812322199344635,
      "pose_rmse_mean": 0.35388654470443726,
      "rmse_dtheta": 0.06050626561045647,
      "rmse_dx": 0.028221972286701202,
      "rmse_dy": 0.011940771713852882,
      "rmse_mean": 0.03355633467435837,
      "rotation_flip": 0.015217390842735767,
      "sparse_tokens": 8091.0,
      "step": 1364,
      "turn_loss": 0.2687154710292816,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.06341758037539491,
      "grad_norm": 0.587033212184906,
      "learning_rate": 9.73188106725395e-06,
      "loss": 0.1547,
      "mae_dtheta": 0.03628000617027283,
      "mae_dx": 0.009464696049690247,
      "mae_dy": 0.004590856377035379,
      "pose_mae_dtheta": 0.27994683384895325,
      "pose_mae_dx": 0.06905724108219147,
      "pose_mae_dy": 0.04333638399839401,
      "pose_rmse_dtheta": 0.5223347544670105,
      "pose_rmse_dx": 0.16081522405147552,
      "pose_rmse_dy": 0.09895577281713486,
      "pose_rmse_mean": 0.2607019245624542,
      "rmse_dtheta": 0.056596823036670685,
      "rmse_dx": 0.019208874553442,
      "rmse_dy": 0.010594210587441921,
      "rmse_mean": 0.02879996970295906,
      "rotation_flip": 0.020300088450312614,
      "sparse_tokens": 18511.0,
      "step": 1365,
      "turn_loss": 0.23710478842258453,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.06346404014123769,
      "grad_norm": 0.8346295952796936,
      "learning_rate": 9.731453736897796e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.04683210328221321,
      "mae_dx": 0.011545981280505657,
      "mae_dy": 0.007053571753203869,
      "pose_mae_dtheta": 0.40506142377853394,
      "pose_mae_dx": 0.08329036831855774,
      "pose_mae_dy": 0.07095540314912796,
      "pose_rmse_dtheta": 0.6375188827514648,
      "pose_rmse_dx": 0.1794975996017456,
      "pose_rmse_dy": 0.15141277015209198,
      "pose_rmse_mean": 0.32280975580215454,
      "rmse_dtheta": 0.06363030523061752,
      "rmse_dx": 0.022774338722229004,
      "rmse_dy": 0.014743715524673462,
      "rmse_mean": 0.033716119825839996,
      "rotation_flip": 0.022573363035917282,
      "sparse_tokens": 7170.0,
      "step": 1366,
      "turn_loss": 0.4030524790287018,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06351049990708046,
      "grad_norm": 0.8612228631973267,
      "learning_rate": 9.731026075668543e-06,
      "loss": 0.1649,
      "mae_dtheta": 0.012040222994983196,
      "mae_dx": 0.0026937350630760193,
      "mae_dy": 0.002268376061692834,
      "pose_mae_dtheta": 0.0864870548248291,
      "pose_mae_dx": 0.035763733088970184,
      "pose_mae_dy": 0.03636922314763069,
      "pose_rmse_dtheta": 0.18134571611881256,
      "pose_rmse_dx": 0.0962672084569931,
      "pose_rmse_dy": 0.08506158739328384,
      "pose_rmse_mean": 0.1208915039896965,
      "rmse_dtheta": 0.024843841791152954,
      "rmse_dx": 0.00856241025030613,
      "rmse_dy": 0.0052202120423316956,
      "rmse_mean": 0.01287548802793026,
      "rotation_flip": 0.004708904307335615,
      "sparse_tokens": 32073.0,
      "step": 1367,
      "turn_loss": 0.09273145347833633,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29754.0,
      "epoch": 0.06355695967292325,
      "grad_norm": 0.6415087580680847,
      "learning_rate": 9.730598083596096e-06,
      "loss": 0.1368,
      "mae_dtheta": 0.033615220338106155,
      "mae_dx": 0.016601096838712692,
      "mae_dy": 0.0038854230660945177,
      "pose_mae_dtheta": 0.25181081891059875,
      "pose_mae_dx": 0.13737158477306366,
      "pose_mae_dy": 0.04673425480723381,
      "pose_rmse_dtheta": 0.453445702791214,
      "pose_rmse_dx": 0.27585601806640625,
      "pose_rmse_dy": 0.10835529118776321,
      "pose_rmse_mean": 0.27921900153160095,
      "rmse_dtheta": 0.05149509385228157,
      "rmse_dx": 0.02988053858280182,
      "rmse_dy": 0.008175715804100037,
      "rmse_mean": 0.029850449413061142,
      "rotation_flip": 0.010441767051815987,
      "sparse_tokens": 24294.0,
      "step": 1368,
      "turn_loss": 0.30964726209640503,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.06360341943876603,
      "grad_norm": 0.7530622482299805,
      "learning_rate": 9.730169760710385e-06,
      "loss": 0.1435,
      "mae_dtheta": 0.03403420001268387,
      "mae_dx": 0.018758293241262436,
      "mae_dy": 0.009255990386009216,
      "pose_mae_dtheta": 0.2493457794189453,
      "pose_mae_dx": 0.19526433944702148,
      "pose_mae_dy": 0.11375423520803452,
      "pose_rmse_dtheta": 0.4029217064380646,
      "pose_rmse_dx": 0.3536589741706848,
      "pose_rmse_dy": 0.25013914704322815,
      "pose_rmse_mean": 0.3355732858181,
      "rmse_dtheta": 0.04809408262372017,
      "rmse_dx": 0.033192284405231476,
      "rmse_dy": 0.020113268867135048,
      "rmse_mean": 0.033799879252910614,
      "rotation_flip": 0.024175824597477913,
      "sparse_tokens": 8861.0,
      "step": 1369,
      "turn_loss": 0.37562093138694763,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.06364987920460881,
      "grad_norm": 0.5684719681739807,
      "learning_rate": 9.729741107041368e-06,
      "loss": 0.1425,
      "mae_dtheta": 0.02746661938726902,
      "mae_dx": 0.007107904180884361,
      "mae_dy": 0.0064654042944312096,
      "pose_mae_dtheta": 0.15550202131271362,
      "pose_mae_dx": 0.05272109806537628,
      "pose_mae_dy": 0.08240688592195511,
      "pose_rmse_dtheta": 0.2550774812698364,
      "pose_rmse_dx": 0.10719311982393265,
      "pose_rmse_dy": 0.1598249077796936,
      "pose_rmse_mean": 0.1740318387746811,
      "rmse_dtheta": 0.04193728789687157,
      "rmse_dx": 0.01636863686144352,
      "rmse_dy": 0.011902268044650555,
      "rmse_mean": 0.023402731865644455,
      "rotation_flip": 0.0038314175326377153,
      "sparse_tokens": 4935.0,
      "step": 1370,
      "turn_loss": 0.3689267337322235,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 23941.0,
      "epoch": 0.06369633897045159,
      "grad_norm": 1.183292031288147,
      "learning_rate": 9.729312122619013e-06,
      "loss": 0.2601,
      "mae_dtheta": 0.029153918847441673,
      "mae_dx": 0.015141510404646397,
      "mae_dy": 0.00460963835939765,
      "pose_mae_dtheta": 0.2283853143453598,
      "pose_mae_dx": 0.13717330992221832,
      "pose_mae_dy": 0.06863531470298767,
      "pose_rmse_dtheta": 0.402332603931427,
      "pose_rmse_dx": 0.30117106437683105,
      "pose_rmse_dy": 0.1740022450685501,
      "pose_rmse_mean": 0.2925019860267639,
      "rmse_dtheta": 0.0449732206761837,
      "rmse_dx": 0.030255019664764404,
      "rmse_dy": 0.010083766654133797,
      "rmse_mean": 0.028437336906790733,
      "rotation_flip": 0.016877636313438416,
      "sparse_tokens": 17920.0,
      "step": 1371,
      "turn_loss": 0.22310084104537964,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06374279873629438,
      "grad_norm": 0.7769225835800171,
      "learning_rate": 9.728882807473324e-06,
      "loss": 0.0915,
      "mae_dtheta": 0.009804987348616123,
      "mae_dx": 0.0027237283065915108,
      "mae_dy": 0.0014671537792310119,
      "pose_mae_dtheta": 0.07201003283262253,
      "pose_mae_dx": 0.02675231546163559,
      "pose_mae_dy": 0.023911939933896065,
      "pose_rmse_dtheta": 0.20588497817516327,
      "pose_rmse_dx": 0.09061120450496674,
      "pose_rmse_dy": 0.057677626609802246,
      "pose_rmse_mean": 0.11805793642997742,
      "rmse_dtheta": 0.02504994347691536,
      "rmse_dx": 0.009361247532069683,
      "rmse_dy": 0.0033506096806377172,
      "rmse_mean": 0.012587266974151134,
      "rotation_flip": 0.0019071836723014712,
      "sparse_tokens": 32073.0,
      "step": 1372,
      "turn_loss": 0.07709472626447678,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.06378925850213715,
      "grad_norm": 0.5710841417312622,
      "learning_rate": 9.728453161634322e-06,
      "loss": 0.1383,
      "mae_dtheta": 0.026439020410180092,
      "mae_dx": 0.010855892673134804,
      "mae_dy": 0.00600275956094265,
      "pose_mae_dtheta": 0.1602173149585724,
      "pose_mae_dx": 0.09393170475959778,
      "pose_mae_dy": 0.06267265975475311,
      "pose_rmse_dtheta": 0.2916426956653595,
      "pose_rmse_dx": 0.2208539843559265,
      "pose_rmse_dy": 0.1259109079837799,
      "pose_rmse_mean": 0.21280252933502197,
      "rmse_dtheta": 0.04097367450594902,
      "rmse_dx": 0.024581007659435272,
      "rmse_dy": 0.010823794640600681,
      "rmse_mean": 0.025459490716457367,
      "rotation_flip": 0.020512821152806282,
      "sparse_tokens": 11066.0,
      "step": 1373,
      "turn_loss": 0.23367179930210114,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.06383571826797993,
      "grad_norm": 0.4770461320877075,
      "learning_rate": 9.728023185132055e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.01804392598569393,
      "mae_dx": 0.008012779988348484,
      "mae_dy": 0.0021621519699692726,
      "pose_mae_dtheta": 0.1281319111585617,
      "pose_mae_dx": 0.05513555929064751,
      "pose_mae_dy": 0.013855500146746635,
      "pose_rmse_dtheta": 0.22928448021411896,
      "pose_rmse_dx": 0.15260407328605652,
      "pose_rmse_dy": 0.030530152842402458,
      "pose_rmse_mean": 0.13747291266918182,
      "rmse_dtheta": 0.031034419313073158,
      "rmse_dx": 0.018477797508239746,
      "rmse_dy": 0.004356512799859047,
      "rmse_mean": 0.017956241965293884,
      "rotation_flip": 0.008230452425777912,
      "sparse_tokens": 4780.0,
      "step": 1374,
      "turn_loss": 0.13791203498840332,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.0638821780338227,
      "grad_norm": 0.6386659741401672,
      "learning_rate": 9.727592877996585e-06,
      "loss": 0.1821,
      "mae_dtheta": 0.03076997958123684,
      "mae_dx": 0.008769429288804531,
      "mae_dy": 0.006807674653828144,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6386660933494568,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 132.9030303955078,
      "model/head/act_norm_mean": 103.46532206632654,
      "model/head/act_norm_min": 79.98844146728516,
      "model/head/act_over_embed": 71.10233798158623,
      "model/head/grad_frac": 0.10275306552648544,
      "model/head/grad_norm": 0.06562490016222,
      "model/head/grad_zero_frac": 0.00020590938220266253,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6880779655612245,
      "model/head/update_ratio": 0.0011422407114878297,
      "model/head/weight_delta": 4.158080577850342,
      "model/head/weight_delta_rel": 0.07294505089521408,
      "model/head/weight_norm": 57.45277786254883,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4122925400733948,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4122925400733948,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4122925400733948,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28333129348201147,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07374700903892517,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04709971323609352,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.54296875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015334631316363811,
      "model/modality_embedder.encoders.pose/weight_delta": 1.3312984704971313,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.04349767044186592,
      "model/modality_embedder.encoders.pose/weight_norm": 30.714603424072266,
      "model/modality_embedder/grad_frac": 0.07374700903892517,
      "model/modality_embedder/grad_norm": 0.04709971323609352,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.54296875,
      "model/modality_embedder/update_ratio": 0.0015334631316363811,
      "model/modality_embedder/weight_delta": 1.3312984704971313,
      "model/modality_embedder/weight_delta_rel": 0.04349767044186592,
      "model/modality_embedder/weight_norm": 30.714603424072266,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 69.8993911743164,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.712192764010368,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.0028076171875,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.6080315023267,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09094886481761932,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.058085955679416656,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0021083306055516005,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.736335277557373,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.026832502335309982,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.55068588256836,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 71.33059692382812,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.586468962585034,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.585123062133789,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.20884229108994,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07419987767934799,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.047388944774866104,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016301680589094758,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.906641960144043,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.03140678629279137,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.069974899291992,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 72.998779296875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.318682681405896,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.371438980102539,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.39923577590398,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07019304484128952,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04482991620898247,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014944837894290686,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.9560400247573853,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.032102033495903015,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 29.996923446655273,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 73.82494354248047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.352025631681244,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.706483840942383,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.796568087789822,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07424968481063843,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04742075502872467,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016119135543704033,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.816462516784668,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.027902813628315926,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.418920516967773,
      "model/normalizer/grad_frac": 0.3531303405761719,
      "model/normalizer/grad_norm": 0.22553236782550812,
      "model/normalizer/grad_zero_frac": 0.0002481650735717267,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002896292833611369,
      "model/normalizer/weight_delta": 1.7583271265029907,
      "model/normalizer/weight_delta_rel": 0.022646235302090645,
      "model/normalizer/weight_norm": 77.86932373046875,
      "pose_mae_dtheta": 0.2553366422653198,
      "pose_mae_dx": 0.08001705259084702,
      "pose_mae_dy": 0.10061778128147125,
      "pose_rmse_dtheta": 0.4099743664264679,
      "pose_rmse_dx": 0.16347594559192657,
      "pose_rmse_dy": 0.1946312040090561,
      "pose_rmse_mean": 0.2560271918773651,
      "rmse_dtheta": 0.045432694256305695,
      "rmse_dx": 0.01976645179092884,
      "rmse_dy": 0.01136681530624628,
      "rmse_mean": 0.025521986186504364,
      "rotation_flip": 0.006079027429223061,
      "sparse_tokens": 13207.0,
      "step": 1375,
      "turn_loss": 0.2736939489841461,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.06392863779966548,
      "grad_norm": 0.44339296221733093,
      "learning_rate": 9.727162240258009e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.012072199024260044,
      "mae_dx": 0.0018257459159940481,
      "mae_dy": 0.0028102498035877943,
      "pose_mae_dtheta": 0.08394347131252289,
      "pose_mae_dx": 0.031028050929307938,
      "pose_mae_dy": 0.03942836821079254,
      "pose_rmse_dtheta": 0.16062314808368683,
      "pose_rmse_dx": 0.07249654084444046,
      "pose_rmse_dy": 0.09131624549627304,
      "pose_rmse_mean": 0.1081453189253807,
      "rmse_dtheta": 0.022096168249845505,
      "rmse_dx": 0.005688474979251623,
      "rmse_dy": 0.00521918386220932,
      "rmse_mean": 0.011001276783645153,
      "rotation_flip": 0.0034977265167981386,
      "sparse_tokens": 32089.0,
      "step": 1376,
      "turn_loss": 0.0899907723069191,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06397509756550827,
      "grad_norm": 0.5574845671653748,
      "learning_rate": 9.72673127194644e-06,
      "loss": 0.1571,
      "mae_dtheta": 0.014443457126617432,
      "mae_dx": 0.002614924916997552,
      "mae_dy": 0.003632873296737671,
      "pose_mae_dtheta": 0.10534525662660599,
      "pose_mae_dx": 0.03805292397737503,
      "pose_mae_dy": 0.04093024879693985,
      "pose_rmse_dtheta": 0.22768229246139526,
      "pose_rmse_dx": 0.09720973670482635,
      "pose_rmse_dy": 0.09683027863502502,
      "pose_rmse_mean": 0.140574112534523,
      "rmse_dtheta": 0.027953533455729485,
      "rmse_dx": 0.007051409222185612,
      "rmse_dy": 0.007986576296389103,
      "rmse_mean": 0.014330506324768066,
      "rotation_flip": 0.0054151625372469425,
      "sparse_tokens": 32105.0,
      "step": 1377,
      "turn_loss": 0.12569400668144226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.06402155733135105,
      "grad_norm": 0.540144145488739,
      "learning_rate": 9.726299973092017e-06,
      "loss": 0.166,
      "mae_dtheta": 0.04238634184002876,
      "mae_dx": 0.010395904071629047,
      "mae_dy": 0.00785713642835617,
      "pose_mae_dtheta": 0.34757623076438904,
      "pose_mae_dx": 0.07978171855211258,
      "pose_mae_dy": 0.06634984910488129,
      "pose_rmse_dtheta": 0.6092899441719055,
      "pose_rmse_dx": 0.19800598919391632,
      "pose_rmse_dy": 0.17565453052520752,
      "pose_rmse_mean": 0.32765015959739685,
      "rmse_dtheta": 0.06335601210594177,
      "rmse_dx": 0.022475259378552437,
      "rmse_dy": 0.01766952872276306,
      "rmse_mean": 0.03450026735663414,
      "rotation_flip": 0.012729844078421593,
      "sparse_tokens": 12656.0,
      "step": 1378,
      "turn_loss": 0.3391610383987427,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.06406801709719383,
      "grad_norm": 0.5968229174613953,
      "learning_rate": 9.7258683437249e-06,
      "loss": 0.1378,
      "mae_dtheta": 0.011786897666752338,
      "mae_dx": 0.002414038171991706,
      "mae_dy": 0.0016013942658901215,
      "pose_mae_dtheta": 0.0850837379693985,
      "pose_mae_dx": 0.025956861674785614,
      "pose_mae_dy": 0.02229367010295391,
      "pose_rmse_dtheta": 0.22588741779327393,
      "pose_rmse_dx": 0.06406708806753159,
      "pose_rmse_dy": 0.05690905079245567,
      "pose_rmse_mean": 0.11562119424343109,
      "rmse_dtheta": 0.02906493842601776,
      "rmse_dx": 0.007132763043045998,
      "rmse_dy": 0.003718036925420165,
      "rmse_mean": 0.013305245898663998,
      "rotation_flip": 0.00318181817419827,
      "sparse_tokens": 32169.0,
      "step": 1379,
      "turn_loss": 0.0849040225148201,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.0641144768630366,
      "grad_norm": 0.5100400447845459,
      "learning_rate": 9.725436383875273e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.027594024315476418,
      "mae_dx": 0.009137468412518501,
      "mae_dy": 0.007333859335631132,
      "pose_mae_dtheta": 0.20284785330295563,
      "pose_mae_dx": 0.0845549926161766,
      "pose_mae_dy": 0.11034517735242844,
      "pose_rmse_dtheta": 0.32565736770629883,
      "pose_rmse_dx": 0.16661609709262848,
      "pose_rmse_dy": 0.2256002277135849,
      "pose_rmse_mean": 0.2392912358045578,
      "rmse_dtheta": 0.04164648801088333,
      "rmse_dx": 0.02029755525290966,
      "rmse_dy": 0.011878818273544312,
      "rmse_mean": 0.024607621133327484,
      "rotation_flip": 0.0069444444961845875,
      "sparse_tokens": 4796.0,
      "step": 1380,
      "turn_loss": 0.2778298556804657,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 30821.0,
      "epoch": 0.0641609366288794,
      "grad_norm": 0.5993006825447083,
      "learning_rate": 9.725004093573343e-06,
      "loss": 0.155,
      "mae_dtheta": 0.04112359136343002,
      "mae_dx": 0.013738893903791904,
      "mae_dy": 0.004645517095923424,
      "pose_mae_dtheta": 0.3300623595714569,
      "pose_mae_dx": 0.10295157879590988,
      "pose_mae_dy": 0.05100066959857941,
      "pose_rmse_dtheta": 0.5675442814826965,
      "pose_rmse_dx": 0.2318960279226303,
      "pose_rmse_dy": 0.15138022601604462,
      "pose_rmse_mean": 0.31694018840789795,
      "rmse_dtheta": 0.06103527918457985,
      "rmse_dx": 0.026499561965465546,
      "rmse_dy": 0.012102151289582253,
      "rmse_mean": 0.0332123339176178,
      "rotation_flip": 0.010467550717294216,
      "sparse_tokens": 25713.0,
      "step": 1381,
      "turn_loss": 0.3074837028980255,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.06420739639472217,
      "grad_norm": 0.5563824772834778,
      "learning_rate": 9.724571472849342e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.013024807907640934,
      "mae_dx": 0.002777482382953167,
      "mae_dy": 0.0019279870903119445,
      "pose_mae_dtheta": 0.09540437906980515,
      "pose_mae_dx": 0.028048424050211906,
      "pose_mae_dy": 0.0271074790507555,
      "pose_rmse_dtheta": 0.23277810215950012,
      "pose_rmse_dx": 0.07553637772798538,
      "pose_rmse_dy": 0.062119461596012115,
      "pose_rmse_mean": 0.1234779804944992,
      "rmse_dtheta": 0.02759268879890442,
      "rmse_dx": 0.008670717477798462,
      "rmse_dy": 0.0044155060313642025,
      "rmse_mean": 0.01355963759124279,
      "rotation_flip": 0.004694835748523474,
      "sparse_tokens": 32153.0,
      "step": 1382,
      "turn_loss": 0.08800410479307175,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.06425385616056495,
      "grad_norm": 0.8123339414596558,
      "learning_rate": 9.724138521733521e-06,
      "loss": 0.1753,
      "mae_dtheta": 0.028594398871064186,
      "mae_dx": 0.01101484801620245,
      "mae_dy": 0.0038776597939431667,
      "pose_mae_dtheta": 0.2175520360469818,
      "pose_mae_dx": 0.09530720859766006,
      "pose_mae_dy": 0.05439010635018349,
      "pose_rmse_dtheta": 0.40511950850486755,
      "pose_rmse_dx": 0.21252278983592987,
      "pose_rmse_dy": 0.12667588889598846,
      "pose_rmse_mean": 0.24810606241226196,
      "rmse_dtheta": 0.046402305364608765,
      "rmse_dx": 0.02338734082877636,
      "rmse_dy": 0.007331723812967539,
      "rmse_mean": 0.025707123801112175,
      "rotation_flip": 0.01133144460618496,
      "sparse_tokens": 12469.0,
      "step": 1383,
      "turn_loss": 0.19921500980854034,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06430031592640773,
      "grad_norm": 0.5409473180770874,
      "learning_rate": 9.723705240256157e-06,
      "loss": 0.1562,
      "mae_dtheta": 0.012853346765041351,
      "mae_dx": 0.001843018806539476,
      "mae_dy": 0.0024983191397041082,
      "pose_mae_dtheta": 0.0916786789894104,
      "pose_mae_dx": 0.027791505679488182,
      "pose_mae_dy": 0.03805437311530113,
      "pose_rmse_dtheta": 0.20600581169128418,
      "pose_rmse_dx": 0.07119717448949814,
      "pose_rmse_dy": 0.09223590791225433,
      "pose_rmse_mean": 0.12314629554748535,
      "rmse_dtheta": 0.025803163647651672,
      "rmse_dx": 0.005310214590281248,
      "rmse_dy": 0.005119107197970152,
      "rmse_mean": 0.012077495455741882,
      "rotation_flip": 0.006477732677012682,
      "sparse_tokens": 32073.0,
      "step": 1384,
      "turn_loss": 0.09377975016832352,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.06434677569225052,
      "grad_norm": 0.37810710072517395,
      "learning_rate": 9.72327162844755e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.013996454887092113,
      "mae_dx": 0.0028039964381605387,
      "mae_dy": 0.003952613566070795,
      "pose_mae_dtheta": 0.09583309292793274,
      "pose_mae_dx": 0.03372800350189209,
      "pose_mae_dy": 0.041087813675403595,
      "pose_rmse_dtheta": 0.20950362086296082,
      "pose_rmse_dx": 0.07967342436313629,
      "pose_rmse_dy": 0.09412062913179398,
      "pose_rmse_mean": 0.12776589393615723,
      "rmse_dtheta": 0.027749964967370033,
      "rmse_dx": 0.00731499120593071,
      "rmse_dy": 0.008603107184171677,
      "rmse_mean": 0.014556022360920906,
      "rotation_flip": 0.00476016104221344,
      "sparse_tokens": 32121.0,
      "step": 1385,
      "turn_loss": 0.14102239906787872,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.06439323545809329,
      "grad_norm": 0.38877856731414795,
      "learning_rate": 9.722837686338025e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.00889169704169035,
      "mae_dx": 0.0016399609157815576,
      "mae_dy": 0.00034734775545075536,
      "pose_mae_dtheta": 0.06332457810640335,
      "pose_mae_dx": 0.014348016120493412,
      "pose_mae_dy": 0.004687619861215353,
      "pose_rmse_dtheta": 0.2663888931274414,
      "pose_rmse_dx": 0.03534114360809326,
      "pose_rmse_dy": 0.009647843427956104,
      "pose_rmse_mean": 0.10379263013601303,
      "rmse_dtheta": 0.031948402523994446,
      "rmse_dx": 0.004779048729687929,
      "rmse_dy": 0.0006088322261348367,
      "rmse_mean": 0.012445427477359772,
      "rotation_flip": 0.003442340763285756,
      "sparse_tokens": 32217.0,
      "step": 1386,
      "turn_loss": 0.04903389886021614,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.06443969522393607,
      "grad_norm": 0.8295701742172241,
      "learning_rate": 9.722403413957924e-06,
      "loss": 0.1897,
      "mae_dtheta": 0.04184244945645332,
      "mae_dx": 0.013438358902931213,
      "mae_dy": 0.006653761025518179,
      "pose_mae_dtheta": 0.34496110677719116,
      "pose_mae_dx": 0.09731123596429825,
      "pose_mae_dy": 0.09792818874120712,
      "pose_rmse_dtheta": 0.5346816182136536,
      "pose_rmse_dx": 0.2137376219034195,
      "pose_rmse_dy": 0.2222757190465927,
      "pose_rmse_mean": 0.3235650062561035,
      "rmse_dtheta": 0.057706404477357864,
      "rmse_dx": 0.02664736472070217,
      "rmse_dy": 0.012990414164960384,
      "rmse_mean": 0.03244806081056595,
      "rotation_flip": 0.010430247522890568,
      "sparse_tokens": 12644.0,
      "step": 1387,
      "turn_loss": 0.34290266036987305,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.06448615498977885,
      "grad_norm": 0.4038791060447693,
      "learning_rate": 9.721968811337617e-06,
      "loss": 0.106,
      "mae_dtheta": 0.03725018724799156,
      "mae_dx": 0.01246238686144352,
      "mae_dy": 0.004038688261061907,
      "pose_mae_dtheta": 0.28706052899360657,
      "pose_mae_dx": 0.12011783570051193,
      "pose_mae_dy": 0.05274807661771774,
      "pose_rmse_dtheta": 0.5036417245864868,
      "pose_rmse_dx": 0.2680872082710266,
      "pose_rmse_dy": 0.14498834311962128,
      "pose_rmse_mean": 0.3055724501609802,
      "rmse_dtheta": 0.057715944945812225,
      "rmse_dx": 0.024591345340013504,
      "rmse_dy": 0.009008720517158508,
      "rmse_mean": 0.030438672751188278,
      "rotation_flip": 0.00538357999175787,
      "sparse_tokens": 13761.0,
      "step": 1388,
      "turn_loss": 0.24601973593235016,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 7147.0,
      "epoch": 0.06453261475562164,
      "grad_norm": 0.7162839770317078,
      "learning_rate": 9.7215338785075e-06,
      "loss": 0.2072,
      "mae_dtheta": 0.029550308361649513,
      "mae_dx": 0.017763549461960793,
      "mae_dy": 0.007259665988385677,
      "pose_mae_dtheta": 0.21836887300014496,
      "pose_mae_dx": 0.15124453604221344,
      "pose_mae_dy": 0.11896452307701111,
      "pose_rmse_dtheta": 0.3661753535270691,
      "pose_rmse_dx": 0.28791481256484985,
      "pose_rmse_dy": 0.2311844527721405,
      "pose_rmse_mean": 0.29509156942367554,
      "rmse_dtheta": 0.04718276485800743,
      "rmse_dx": 0.03240015357732773,
      "rmse_dy": 0.012269046157598495,
      "rmse_mean": 0.030617322772741318,
      "rotation_flip": 0.022435897961258888,
      "sparse_tokens": 5304.0,
      "step": 1389,
      "turn_loss": 0.29424750804901123,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.06457907452146441,
      "grad_norm": 0.6637872457504272,
      "learning_rate": 9.72109861549798e-06,
      "loss": 0.1289,
      "mae_dtheta": 0.03893803060054779,
      "mae_dx": 0.01392944436520338,
      "mae_dy": 0.007582035381346941,
      "pose_mae_dtheta": 0.31203943490982056,
      "pose_mae_dx": 0.12386886775493622,
      "pose_mae_dy": 0.0830337405204773,
      "pose_rmse_dtheta": 0.5180262327194214,
      "pose_rmse_dx": 0.25281864404678345,
      "pose_rmse_dy": 0.22702792286872864,
      "pose_rmse_mean": 0.33262428641319275,
      "rmse_dtheta": 0.05703184753656387,
      "rmse_dx": 0.02610175497829914,
      "rmse_dy": 0.018285531550645828,
      "rmse_mean": 0.03380637988448143,
      "rotation_flip": 0.010262989439070225,
      "sparse_tokens": 23745.0,
      "step": 1390,
      "turn_loss": 0.33613133430480957,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.06462553428730719,
      "grad_norm": 0.531825840473175,
      "learning_rate": 9.720663022339503e-06,
      "loss": 0.131,
      "mae_dtheta": 0.03805873170495033,
      "mae_dx": 0.017641572281718254,
      "mae_dy": 0.003165506524965167,
      "pose_mae_dtheta": 0.29940682649612427,
      "pose_mae_dx": 0.15498694777488708,
      "pose_mae_dy": 0.04301951080560684,
      "pose_rmse_dtheta": 0.4705355763435364,
      "pose_rmse_dx": 0.29055115580558777,
      "pose_rmse_dy": 0.08673442900180817,
      "pose_rmse_mean": 0.2826070487499237,
      "rmse_dtheta": 0.05425185710191727,
      "rmse_dx": 0.031427085399627686,
      "rmse_dy": 0.005229388363659382,
      "rmse_mean": 0.030302777886390686,
      "rotation_flip": 0.02139037474989891,
      "sparse_tokens": 3067.0,
      "step": 1391,
      "turn_loss": 0.30334004759788513,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.06467199405314997,
      "grad_norm": 0.5310969948768616,
      "learning_rate": 9.720227099062525e-06,
      "loss": 0.1615,
      "mae_dtheta": 0.014316602610051632,
      "mae_dx": 0.0032138742972165346,
      "mae_dy": 0.004350543487817049,
      "pose_mae_dtheta": 0.10064540058374405,
      "pose_mae_dx": 0.043536148965358734,
      "pose_mae_dy": 0.05168519914150238,
      "pose_rmse_dtheta": 0.20112773776054382,
      "pose_rmse_dx": 0.09967286884784698,
      "pose_rmse_dy": 0.11806748807430267,
      "pose_rmse_mean": 0.13962271809577942,
      "rmse_dtheta": 0.026583198457956314,
      "rmse_dx": 0.008910096250474453,
      "rmse_dy": 0.008309561759233475,
      "rmse_mean": 0.014600953087210655,
      "rotation_flip": 0.008016730658710003,
      "sparse_tokens": 32057.0,
      "step": 1392,
      "turn_loss": 0.12835785746574402,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.06471845381899276,
      "grad_norm": 0.46413323283195496,
      "learning_rate": 9.719790845697534e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.03764992952346802,
      "mae_dx": 0.012159861624240875,
      "mae_dy": 0.006254213396459818,
      "pose_mae_dtheta": 0.2987501919269562,
      "pose_mae_dx": 0.10962720960378647,
      "pose_mae_dy": 0.08790125697851181,
      "pose_rmse_dtheta": 0.4833180904388428,
      "pose_rmse_dx": 0.2187928408384323,
      "pose_rmse_dy": 0.18044383823871613,
      "pose_rmse_mean": 0.29418492317199707,
      "rmse_dtheta": 0.05217425525188446,
      "rmse_dx": 0.023367663845419884,
      "rmse_dy": 0.011339491233229637,
      "rmse_mean": 0.028960471972823143,
      "rotation_flip": 0.013698630034923553,
      "sparse_tokens": 9552.0,
      "step": 1393,
      "turn_loss": 0.25754138827323914,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.06476491358483553,
      "grad_norm": 0.49273064732551575,
      "learning_rate": 9.719354262275036e-06,
      "loss": 0.0813,
      "mae_dtheta": 0.008716379292309284,
      "mae_dx": 0.001852413173764944,
      "mae_dy": 0.0016506832325831056,
      "pose_mae_dtheta": 0.056543901562690735,
      "pose_mae_dx": 0.017393166199326515,
      "pose_mae_dy": 0.023701636120676994,
      "pose_rmse_dtheta": 0.1482311636209488,
      "pose_rmse_dx": 0.04733970761299133,
      "pose_rmse_dy": 0.05786548927426338,
      "pose_rmse_mean": 0.08447878807783127,
      "rmse_dtheta": 0.020821647718548775,
      "rmse_dx": 0.005760110914707184,
      "rmse_dy": 0.004076140001416206,
      "rmse_mean": 0.010219300165772438,
      "rotation_flip": 0.0036341610830277205,
      "sparse_tokens": 32089.0,
      "step": 1394,
      "turn_loss": 0.07814048230648041,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28139.0,
      "epoch": 0.06481137335067831,
      "grad_norm": 0.5370357632637024,
      "learning_rate": 9.71891734882556e-06,
      "loss": 0.1223,
      "mae_dtheta": 0.0304717980325222,
      "mae_dx": 0.010469458997249603,
      "mae_dy": 0.006312198005616665,
      "pose_mae_dtheta": 0.2550245225429535,
      "pose_mae_dx": 0.08700797706842422,
      "pose_mae_dy": 0.06954506039619446,
      "pose_rmse_dtheta": 0.4469814896583557,
      "pose_rmse_dx": 0.18761228024959564,
      "pose_rmse_dy": 0.15165360271930695,
      "pose_rmse_mean": 0.26208245754241943,
      "rmse_dtheta": 0.04704464226961136,
      "rmse_dx": 0.021757248789072037,
      "rmse_dy": 0.01182636246085167,
      "rmse_mean": 0.026876088231801987,
      "rotation_flip": 0.007949125953018665,
      "sparse_tokens": 22206.0,
      "step": 1395,
      "turn_loss": 0.30227363109588623,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.06485783311652109,
      "grad_norm": 0.7520999908447266,
      "learning_rate": 9.718480105379663e-06,
      "loss": 0.2109,
      "mae_dtheta": 0.015396066941320896,
      "mae_dx": 0.004111063666641712,
      "mae_dy": 0.005507529713213444,
      "pose_mae_dtheta": 0.10972084850072861,
      "pose_mae_dx": 0.05379221588373184,
      "pose_mae_dy": 0.0523681566119194,
      "pose_rmse_dtheta": 0.2338234931230545,
      "pose_rmse_dx": 0.127181738615036,
      "pose_rmse_dy": 0.12303555756807327,
      "pose_rmse_mean": 0.1613469421863556,
      "rmse_dtheta": 0.02920388989150524,
      "rmse_dx": 0.009838372468948364,
      "rmse_dy": 0.011703462339937687,
      "rmse_mean": 0.01691524311900139,
      "rotation_flip": 0.006457862444221973,
      "sparse_tokens": 32137.0,
      "step": 1396,
      "turn_loss": 0.1760503649711609,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.06490429288236388,
      "grad_norm": 0.5758060812950134,
      "learning_rate": 9.718042531967918e-06,
      "loss": 0.134,
      "mae_dtheta": 0.03040054440498352,
      "mae_dx": 0.01348994392901659,
      "mae_dy": 0.005246346816420555,
      "pose_mae_dtheta": 0.22141924500465393,
      "pose_mae_dx": 0.10059622675180435,
      "pose_mae_dy": 0.06489530950784683,
      "pose_rmse_dtheta": 0.38294193148612976,
      "pose_rmse_dx": 0.22303985059261322,
      "pose_rmse_dy": 0.1389005035161972,
      "pose_rmse_mean": 0.24829410016536713,
      "rmse_dtheta": 0.04514698311686516,
      "rmse_dx": 0.025941800326108932,
      "rmse_dy": 0.009506483562290668,
      "rmse_mean": 0.026865091174840927,
      "rotation_flip": 0.008675078861415386,
      "sparse_tokens": 19857.0,
      "step": 1397,
      "turn_loss": 0.27949580550193787,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.06495075264820666,
      "grad_norm": 0.5177192687988281,
      "learning_rate": 9.717604628620927e-06,
      "loss": 0.1416,
      "mae_dtheta": 0.030858350917696953,
      "mae_dx": 0.008192280307412148,
      "mae_dy": 0.005528707057237625,
      "pose_mae_dtheta": 0.243052676320076,
      "pose_mae_dx": 0.062274299561977386,
      "pose_mae_dy": 0.06506823003292084,
      "pose_rmse_dtheta": 0.4444248378276825,
      "pose_rmse_dx": 0.15971727669239044,
      "pose_rmse_dy": 0.1504839062690735,
      "pose_rmse_mean": 0.25154203176498413,
      "rmse_dtheta": 0.04879027605056763,
      "rmse_dx": 0.019643599167466164,
      "rmse_dy": 0.011879850178956985,
      "rmse_mean": 0.026771243661642075,
      "rotation_flip": 0.011315417475998402,
      "sparse_tokens": 12321.0,
      "step": 1398,
      "turn_loss": 0.27531737089157104,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.06499721241404943,
      "grad_norm": 0.6631055474281311,
      "learning_rate": 9.717166395369312e-06,
      "loss": 0.1536,
      "mae_dtheta": 0.01717585325241089,
      "mae_dx": 0.0042947931215167046,
      "mae_dy": 0.006802616640925407,
      "pose_mae_dtheta": 0.13238270580768585,
      "pose_mae_dx": 0.06094087287783623,
      "pose_mae_dy": 0.059573300182819366,
      "pose_rmse_dtheta": 0.27821144461631775,
      "pose_rmse_dx": 0.15113361179828644,
      "pose_rmse_dy": 0.12343716621398926,
      "pose_rmse_mean": 0.184260755777359,
      "rmse_dtheta": 0.03053773194551468,
      "rmse_dx": 0.009913172572851181,
      "rmse_dy": 0.013314643874764442,
      "rmse_mean": 0.017921850085258484,
      "rotation_flip": 0.00736278435215354,
      "sparse_tokens": 32089.0,
      "step": 1399,
      "turn_loss": 0.15391850471496582,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.06504367217989221,
      "grad_norm": 0.6349122524261475,
      "learning_rate": 9.71672783224372e-06,
      "loss": 0.1156,
      "mae_dtheta": 0.01510272640734911,
      "mae_dx": 0.0025328064803034067,
      "mae_dy": 0.0027718034107238054,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6349121928215027,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.2185516357422,
      "model/head/act_norm_mean": 111.51572364267676,
      "model/head/act_norm_min": 69.3586654663086,
      "model/head/act_over_embed": 76.63464931390112,
      "model/head/grad_frac": 0.12465450167655945,
      "model/head/grad_norm": 0.0791446641087532,
      "model/head/grad_zero_frac": 0.00012786051956936717,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6872238005050505,
      "model/head/update_ratio": 0.0013773547252640128,
      "model/head/weight_delta": 4.196319580078125,
      "model/head/weight_delta_rel": 0.07361587136983871,
      "model/head/weight_norm": 57.46134948730469,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4123634397983551,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.412301655907988,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4122333526611328,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2833375579688877,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07904352992773056,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05018569901585579,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5080620181718062,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016338833374902606,
      "model/modality_embedder.encoders.pose/weight_delta": 1.3426929712295532,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.04386996477842331,
      "model/modality_embedder.encoders.pose/weight_norm": 30.715595245361328,
      "model/modality_embedder/grad_frac": 0.07904352992773056,
      "model/modality_embedder/grad_norm": 0.05018569901585579,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5080620181718062,
      "model/modality_embedder/update_ratio": 0.0016338833374902606,
      "model/modality_embedder/weight_delta": 1.3426929712295532,
      "model/modality_embedder/weight_delta_rel": 0.04386996477842331,
      "model/modality_embedder/weight_norm": 30.715595245361328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.22843933105469,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.480925324675326,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.991398811340332,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.13631171500328,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09296421706676483,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05902411416172981,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0021422123536467552,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.7477176189422607,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.02724728174507618,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.55287742614746,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.62487030029297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.532106782106784,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.20269775390625,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.858693453866035,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10183161497116089,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06465413421392441,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0022237335797399282,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.9212913513183594,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.031914252787828445,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.0745849609375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.55931854248047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.430355138688473,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.440691947937012,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.163187496190083,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11200392991304398,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07111266255378723,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0023703095503151417,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.9717614650726318,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.03262992948293686,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.00142478942871,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.17308807373047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.288239538239537,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.638142585754395,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.439943049349367,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.13840679824352264,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08787616342306137,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 9.0784378699027e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0029867286793887615,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.830005407333374,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.028365645557641983,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.422210693359375,
      "model/normalizer/grad_frac": 0.4890505075454712,
      "model/normalizer/grad_norm": 0.31050413846969604,
      "model/normalizer/grad_zero_frac": 0.00013708166079595685,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0039872536435723305,
      "model/normalizer/weight_delta": 1.7867939472198486,
      "model/normalizer/weight_delta_rel": 0.02301287092268467,
      "model/normalizer/weight_norm": 77.87418365478516,
      "pose_mae_dtheta": 0.11016577482223511,
      "pose_mae_dx": 0.03129580244421959,
      "pose_mae_dy": 0.03520066291093826,
      "pose_rmse_dtheta": 0.26183003187179565,
      "pose_rmse_dx": 0.07045295089483261,
      "pose_rmse_dy": 0.08334695547819138,
      "pose_rmse_mean": 0.13854332268238068,
      "rmse_dtheta": 0.030450189486145973,
      "rmse_dx": 0.006371939554810524,
      "rmse_dy": 0.0058005861937999725,
      "rmse_mean": 0.014207571744918823,
      "rotation_flip": 0.0037878789007663727,
      "sparse_tokens": 32137.0,
      "step": 1400,
      "turn_loss": 0.11326698958873749,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.06504367217989221,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3263445198535919,
      "eval_objectnav_nopose_mae_dtheta": 0.04245300590991974,
      "eval_objectnav_nopose_mae_dx": 0.014410830102860928,
      "eval_objectnav_nopose_mae_dy": 0.005447826348245144,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.34201300144195557,
      "eval_objectnav_nopose_pose_mae_dx": 0.11822055280208588,
      "eval_objectnav_nopose_pose_mae_dy": 0.0614665187895298,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5597971677780151,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24670110642910004,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13999907672405243,
      "eval_objectnav_nopose_pose_rmse_mean": 0.31549912691116333,
      "eval_objectnav_nopose_rmse_dtheta": 0.05994237959384918,
      "eval_objectnav_nopose_rmse_dx": 0.02706298790872097,
      "eval_objectnav_nopose_rmse_dy": 0.0109457578510046,
      "eval_objectnav_nopose_rmse_mean": 0.03265037760138512,
      "eval_objectnav_nopose_rotation_flip": 0.015363538637757301,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3263445198535919,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 1400
    },
    {
      "epoch": 0.06504367217989221,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2974052131175995,
      "eval_objectnav_pose_mae_dtheta": 0.03787025436758995,
      "eval_objectnav_pose_mae_dx": 0.01238310243934393,
      "eval_objectnav_pose_mae_dy": 0.005120999179780483,
      "eval_objectnav_pose_pose_mae_dtheta": 0.29425668716430664,
      "eval_objectnav_pose_pose_mae_dx": 0.09878913313150406,
      "eval_objectnav_pose_pose_mae_dy": 0.05722186714410782,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5050723552703857,
      "eval_objectnav_pose_pose_rmse_dx": 0.21793220937252045,
      "eval_objectnav_pose_pose_rmse_dy": 0.13664574921131134,
      "eval_objectnav_pose_pose_rmse_mean": 0.2865501046180725,
      "eval_objectnav_pose_rmse_dtheta": 0.055906083434820175,
      "eval_objectnav_pose_rmse_dx": 0.02470247447490692,
      "eval_objectnav_pose_rmse_dy": 0.010734139941632748,
      "eval_objectnav_pose_rmse_mean": 0.030447568744421005,
      "eval_objectnav_pose_rotation_flip": 0.015292179770767689,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2974052131175995,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 1400
    },
    {
      "epoch": 0.06504367217989221,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.1081651970744133,
      "eval_pointnav_mae_dtheta": 0.012843864038586617,
      "eval_pointnav_mae_dx": 0.0031476393342018127,
      "eval_pointnav_mae_dy": 0.0031362646259367466,
      "eval_pointnav_pose_mae_dtheta": 0.09197599440813065,
      "eval_pointnav_pose_mae_dx": 0.036969251930713654,
      "eval_pointnav_pose_mae_dy": 0.034894950687885284,
      "eval_pointnav_pose_rmse_dtheta": 0.2365127056837082,
      "eval_pointnav_pose_rmse_dx": 0.09933053702116013,
      "eval_pointnav_pose_rmse_dy": 0.09505082666873932,
      "eval_pointnav_pose_rmse_mean": 0.14363136887550354,
      "eval_pointnav_rmse_dtheta": 0.028621286153793335,
      "eval_pointnav_rmse_dx": 0.00891755148768425,
      "eval_pointnav_rmse_dy": 0.007754718419164419,
      "eval_pointnav_rmse_mean": 0.015097851864993572,
      "eval_pointnav_rotation_flip": 0.005897499620914459,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.1081651970744133,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 1400
    },
    {
      "epoch": 0.06504367217989221,
      "eval_loss": 0.2439716433485349,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3263445198535919,
      "eval_objectnav_nopose_mae_dtheta": 0.04245300590991974,
      "eval_objectnav_nopose_mae_dx": 0.014410830102860928,
      "eval_objectnav_nopose_mae_dy": 0.005447826348245144,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.34201300144195557,
      "eval_objectnav_nopose_pose_mae_dx": 0.11822055280208588,
      "eval_objectnav_nopose_pose_mae_dy": 0.0614665187895298,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5597971677780151,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24670110642910004,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13999907672405243,
      "eval_objectnav_nopose_pose_rmse_mean": 0.31549912691116333,
      "eval_objectnav_nopose_rmse_dtheta": 0.05994237959384918,
      "eval_objectnav_nopose_rmse_dx": 0.02706298790872097,
      "eval_objectnav_nopose_rmse_dy": 0.0109457578510046,
      "eval_objectnav_nopose_rmse_mean": 0.03265037760138512,
      "eval_objectnav_nopose_rotation_flip": 0.015363538637757301,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3263445198535919,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2974052131175995,
      "eval_objectnav_pose_mae_dtheta": 0.03787025436758995,
      "eval_objectnav_pose_mae_dx": 0.01238310243934393,
      "eval_objectnav_pose_mae_dy": 0.005120999179780483,
      "eval_objectnav_pose_pose_mae_dtheta": 0.29425668716430664,
      "eval_objectnav_pose_pose_mae_dx": 0.09878913313150406,
      "eval_objectnav_pose_pose_mae_dy": 0.05722186714410782,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5050723552703857,
      "eval_objectnav_pose_pose_rmse_dx": 0.21793220937252045,
      "eval_objectnav_pose_pose_rmse_dy": 0.13664574921131134,
      "eval_objectnav_pose_pose_rmse_mean": 0.2865501046180725,
      "eval_objectnav_pose_rmse_dtheta": 0.055906083434820175,
      "eval_objectnav_pose_rmse_dx": 0.02470247447490692,
      "eval_objectnav_pose_rmse_dy": 0.010734139941632748,
      "eval_objectnav_pose_rmse_mean": 0.030447568744421005,
      "eval_objectnav_pose_rotation_flip": 0.015292179770767689,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2974052131175995,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.1081651970744133,
      "eval_pointnav_mae_dtheta": 0.012843864038586617,
      "eval_pointnav_mae_dx": 0.0031476393342018127,
      "eval_pointnav_mae_dy": 0.0031362646259367466,
      "eval_pointnav_pose_mae_dtheta": 0.09197599440813065,
      "eval_pointnav_pose_mae_dx": 0.036969251930713654,
      "eval_pointnav_pose_mae_dy": 0.034894950687885284,
      "eval_pointnav_pose_rmse_dtheta": 0.2365127056837082,
      "eval_pointnav_pose_rmse_dx": 0.09933053702116013,
      "eval_pointnav_pose_rmse_dy": 0.09505082666873932,
      "eval_pointnav_pose_rmse_mean": 0.14363136887550354,
      "eval_pointnav_rmse_dtheta": 0.028621286153793335,
      "eval_pointnav_rmse_dx": 0.00891755148768425,
      "eval_pointnav_rmse_dy": 0.007754718419164419,
      "eval_pointnav_rmse_mean": 0.015097851864993572,
      "eval_pointnav_rotation_flip": 0.005897499620914459,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.1081651970744133,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 1400
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.065090131945735,
      "grad_norm": 0.5186992287635803,
      "learning_rate": 9.716288939274818e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.01174206007272005,
      "mae_dx": 0.0029556641820818186,
      "mae_dy": 0.002324372064322233,
      "pose_mae_dtheta": 0.08460001647472382,
      "pose_mae_dx": 0.033716022968292236,
      "pose_mae_dy": 0.028587643057107925,
      "pose_rmse_dtheta": 0.2243623584508896,
      "pose_rmse_dx": 0.07573927938938141,
      "pose_rmse_dy": 0.07425007969141006,
      "pose_rmse_mean": 0.12478390336036682,
      "rmse_dtheta": 0.026860089972615242,
      "rmse_dx": 0.007357107009738684,
      "rmse_dy": 0.0056010582484304905,
      "rmse_mean": 0.013272752985358238,
      "rotation_flip": 0.0041782730259001255,
      "sparse_tokens": 32233.0,
      "step": 1401,
      "turn_loss": 0.09307089447975159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06513659171157778,
      "grad_norm": 0.4678579866886139,
      "learning_rate": 9.7158497164933e-06,
      "loss": 0.0862,
      "mae_dtheta": 0.01058774720877409,
      "mae_dx": 0.0018983810441568494,
      "mae_dy": 0.002692075679078698,
      "pose_mae_dtheta": 0.07993358373641968,
      "pose_mae_dx": 0.02548213303089142,
      "pose_mae_dy": 0.039688341319561005,
      "pose_rmse_dtheta": 0.18925119936466217,
      "pose_rmse_dx": 0.07022761553525925,
      "pose_rmse_dy": 0.1114107072353363,
      "pose_rmse_mean": 0.12362983822822571,
      "rmse_dtheta": 0.021712444722652435,
      "rmse_dx": 0.005321831442415714,
      "rmse_dy": 0.006248669233173132,
      "rmse_mean": 0.011094314977526665,
      "rotation_flip": 0.005569996312260628,
      "sparse_tokens": 32105.0,
      "step": 1402,
      "turn_loss": 0.08825292438268661,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06518305147742055,
      "grad_norm": 0.5130768418312073,
      "learning_rate": 9.715410163929879e-06,
      "loss": 0.143,
      "mae_dtheta": 0.014826469123363495,
      "mae_dx": 0.0023903471883386374,
      "mae_dy": 0.003129490651190281,
      "pose_mae_dtheta": 0.10332336276769638,
      "pose_mae_dx": 0.03246625140309334,
      "pose_mae_dy": 0.04167868569493294,
      "pose_rmse_dtheta": 0.22209501266479492,
      "pose_rmse_dx": 0.07623064517974854,
      "pose_rmse_dy": 0.08463180810213089,
      "pose_rmse_mean": 0.12765249609947205,
      "rmse_dtheta": 0.027308259159326553,
      "rmse_dx": 0.007038699928671122,
      "rmse_dy": 0.006049741059541702,
      "rmse_mean": 0.013465567491948605,
      "rotation_flip": 0.007289135828614235,
      "sparse_tokens": 32105.0,
      "step": 1403,
      "turn_loss": 0.10016921162605286,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32763.0,
      "epoch": 0.06522951124326333,
      "grad_norm": 0.854493260383606,
      "learning_rate": 9.714970281615296e-06,
      "loss": 0.2756,
      "mae_dtheta": 0.03430388495326042,
      "mae_dx": 0.01346517913043499,
      "mae_dy": 0.008317509666085243,
      "pose_mae_dtheta": 0.26760604977607727,
      "pose_mae_dx": 0.11673660576343536,
      "pose_mae_dy": 0.06751177459955215,
      "pose_rmse_dtheta": 0.48308899998664856,
      "pose_rmse_dx": 0.24719825387001038,
      "pose_rmse_dy": 0.1856301724910736,
      "pose_rmse_mean": 0.3053058087825775,
      "rmse_dtheta": 0.05311797186732292,
      "rmse_dx": 0.02536087855696678,
      "rmse_dy": 0.018143197521567345,
      "rmse_mean": 0.03220735117793083,
      "rotation_flip": 0.01508196722716093,
      "sparse_tokens": 27404.0,
      "step": 1404,
      "turn_loss": 0.34180521965026855,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.06527597100910612,
      "grad_norm": 0.5044107437133789,
      "learning_rate": 9.71453006958031e-06,
      "loss": 0.108,
      "mae_dtheta": 0.034267302602529526,
      "mae_dx": 0.013901853933930397,
      "mae_dy": 0.004059894941747189,
      "pose_mae_dtheta": 0.26865315437316895,
      "pose_mae_dx": 0.10576507449150085,
      "pose_mae_dy": 0.04125826433300972,
      "pose_rmse_dtheta": 0.45498690009117126,
      "pose_rmse_dx": 0.2298184037208557,
      "pose_rmse_dy": 0.10805247724056244,
      "pose_rmse_mean": 0.2642859220504761,
      "rmse_dtheta": 0.05184195563197136,
      "rmse_dx": 0.0262282807379961,
      "rmse_dy": 0.008500310592353344,
      "rmse_mean": 0.028856849297881126,
      "rotation_flip": 0.013245033100247383,
      "sparse_tokens": 6910.0,
      "step": 1405,
      "turn_loss": 0.2916688919067383,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.0653224307749489,
      "grad_norm": 0.45262762904167175,
      "learning_rate": 9.714089527855705e-06,
      "loss": 0.08,
      "mae_dtheta": 0.00564943440258503,
      "mae_dx": 0.0017628365894779563,
      "mae_dy": 0.0008358311024494469,
      "pose_mae_dtheta": 0.04307464510202408,
      "pose_mae_dx": 0.015854720026254654,
      "pose_mae_dy": 0.011239249259233475,
      "pose_rmse_dtheta": 0.1462050974369049,
      "pose_rmse_dx": 0.0414997823536396,
      "pose_rmse_dy": 0.03473912924528122,
      "pose_rmse_mean": 0.07414799928665161,
      "rmse_dtheta": 0.01810651645064354,
      "rmse_dx": 0.005153304897248745,
      "rmse_dy": 0.002396949101239443,
      "rmse_mean": 0.008552256971597672,
      "rotation_flip": 0.0006605020025745034,
      "sparse_tokens": 32137.0,
      "step": 1406,
      "turn_loss": 0.048620935529470444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.06536889054079167,
      "grad_norm": 0.5034764409065247,
      "learning_rate": 9.713648656472289e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.026602551341056824,
      "mae_dx": 0.009049628861248493,
      "mae_dy": 0.0038937462959438562,
      "pose_mae_dtheta": 0.21923473477363586,
      "pose_mae_dx": 0.08028306066989899,
      "pose_mae_dy": 0.05753385275602341,
      "pose_rmse_dtheta": 0.41980504989624023,
      "pose_rmse_dx": 0.20066393911838531,
      "pose_rmse_dy": 0.14246799051761627,
      "pose_rmse_mean": 0.25431233644485474,
      "rmse_dtheta": 0.04347897693514824,
      "rmse_dx": 0.021655170246958733,
      "rmse_dy": 0.0073496210388839245,
      "rmse_mean": 0.02416125498712063,
      "rotation_flip": 0.010263930074870586,
      "sparse_tokens": 12019.0,
      "step": 1407,
      "turn_loss": 0.17891548573970795,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.06541535030663445,
      "grad_norm": 0.6655626893043518,
      "learning_rate": 9.713207455460893e-06,
      "loss": 0.1491,
      "mae_dtheta": 0.04503738880157471,
      "mae_dx": 0.013808125630021095,
      "mae_dy": 0.005518107209354639,
      "pose_mae_dtheta": 0.37721681594848633,
      "pose_mae_dx": 0.1120275929570198,
      "pose_mae_dy": 0.06874193251132965,
      "pose_rmse_dtheta": 0.6083021759986877,
      "pose_rmse_dx": 0.2361198216676712,
      "pose_rmse_dy": 0.15145550668239594,
      "pose_rmse_mean": 0.33195918798446655,
      "rmse_dtheta": 0.06294132769107819,
      "rmse_dx": 0.026557497680187225,
      "rmse_dy": 0.010821433737874031,
      "rmse_mean": 0.033440086990594864,
      "rotation_flip": 0.01688411273062229,
      "sparse_tokens": 20738.0,
      "step": 1408,
      "turn_loss": 0.31695103645324707,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.06546181007247723,
      "grad_norm": 0.6206752061843872,
      "learning_rate": 9.71276592485237e-06,
      "loss": 0.1961,
      "mae_dtheta": 0.015135092660784721,
      "mae_dx": 0.003048811573535204,
      "mae_dy": 0.004180834628641605,
      "pose_mae_dtheta": 0.10488452017307281,
      "pose_mae_dx": 0.036866456270217896,
      "pose_mae_dy": 0.0369393564760685,
      "pose_rmse_dtheta": 0.2484310418367386,
      "pose_rmse_dx": 0.09061504900455475,
      "pose_rmse_dy": 0.09570038318634033,
      "pose_rmse_mean": 0.14491549134254456,
      "rmse_dtheta": 0.030151301994919777,
      "rmse_dx": 0.00728085869923234,
      "rmse_dy": 0.00903936568647623,
      "rmse_mean": 0.015490508638322353,
      "rotation_flip": 0.006720430217683315,
      "sparse_tokens": 32169.0,
      "step": 1409,
      "turn_loss": 0.14401161670684814,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.06550826983832002,
      "grad_norm": 0.39697131514549255,
      "learning_rate": 9.712324064677597e-06,
      "loss": 0.1218,
      "mae_dtheta": 0.02846364676952362,
      "mae_dx": 0.014929131604731083,
      "mae_dy": 0.005688420496881008,
      "pose_mae_dtheta": 0.22749504446983337,
      "pose_mae_dx": 0.1022234633564949,
      "pose_mae_dy": 0.06867548078298569,
      "pose_rmse_dtheta": 0.4177543818950653,
      "pose_rmse_dx": 0.24329634010791779,
      "pose_rmse_dy": 0.17177897691726685,
      "pose_rmse_mean": 0.2776099145412445,
      "rmse_dtheta": 0.04587346687912941,
      "rmse_dx": 0.029685165733098984,
      "rmse_dy": 0.01113984640687704,
      "rmse_mean": 0.02889949455857277,
      "rotation_flip": 0.012552301399409771,
      "sparse_tokens": 4531.0,
      "step": 1410,
      "turn_loss": 0.22324609756469727,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.0655547296041628,
      "grad_norm": 0.7877320051193237,
      "learning_rate": 9.711881874967471e-06,
      "loss": 0.2476,
      "mae_dtheta": 0.0358712375164032,
      "mae_dx": 0.013697325251996517,
      "mae_dy": 0.004072943236678839,
      "pose_mae_dtheta": 0.2853420078754425,
      "pose_mae_dx": 0.11958540976047516,
      "pose_mae_dy": 0.055973585695028305,
      "pose_rmse_dtheta": 0.5230859518051147,
      "pose_rmse_dx": 0.25746580958366394,
      "pose_rmse_dy": 0.14009766280651093,
      "pose_rmse_mean": 0.30688315629959106,
      "rmse_dtheta": 0.053376439958810806,
      "rmse_dx": 0.026912959292531013,
      "rmse_dy": 0.009613814763724804,
      "rmse_mean": 0.029967738315463066,
      "rotation_flip": 0.025183631107211113,
      "sparse_tokens": 15902.0,
      "step": 1411,
      "turn_loss": 0.23006948828697205,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.06560118937000557,
      "grad_norm": 0.6156690120697021,
      "learning_rate": 9.711439355752918e-06,
      "loss": 0.1582,
      "mae_dtheta": 0.020803503692150116,
      "mae_dx": 0.007476994767785072,
      "mae_dy": 0.0010987169807776809,
      "pose_mae_dtheta": 0.17144562304019928,
      "pose_mae_dx": 0.05284779518842697,
      "pose_mae_dy": 0.014974776655435562,
      "pose_rmse_dtheta": 0.30841681361198425,
      "pose_rmse_dx": 0.11303379386663437,
      "pose_rmse_dy": 0.030414100736379623,
      "pose_rmse_mean": 0.15062157809734344,
      "rmse_dtheta": 0.03688646852970123,
      "rmse_dx": 0.015251964330673218,
      "rmse_dy": 0.002082404913380742,
      "rmse_mean": 0.018073612824082375,
      "rotation_flip": 0.010101010091602802,
      "sparse_tokens": 3890.0,
      "step": 1412,
      "turn_loss": 0.13201580941677094,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.06564764913584835,
      "grad_norm": 0.9571012854576111,
      "learning_rate": 9.710996507064881e-06,
      "loss": 0.1928,
      "mae_dtheta": 0.01578584872186184,
      "mae_dx": 0.004264677409082651,
      "mae_dy": 0.003947662189602852,
      "pose_mae_dtheta": 0.12982086837291718,
      "pose_mae_dx": 0.0448322594165802,
      "pose_mae_dy": 0.03580818697810173,
      "pose_rmse_dtheta": 0.297112375497818,
      "pose_rmse_dx": 0.13423249125480652,
      "pose_rmse_dy": 0.09486991167068481,
      "pose_rmse_mean": 0.17540493607521057,
      "rmse_dtheta": 0.033710774034261703,
      "rmse_dx": 0.011883012019097805,
      "rmse_dy": 0.011384137906134129,
      "rmse_mean": 0.01899264194071293,
      "rotation_flip": 0.006371814291924238,
      "sparse_tokens": 32169.0,
      "step": 1413,
      "turn_loss": 0.15480023622512817,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.06569410890169114,
      "grad_norm": 0.810347855091095,
      "learning_rate": 9.71055332893433e-06,
      "loss": 0.1372,
      "mae_dtheta": 0.035248447209596634,
      "mae_dx": 0.022111164405941963,
      "mae_dy": 0.007014680653810501,
      "pose_mae_dtheta": 0.2842361629009247,
      "pose_mae_dx": 0.15725401043891907,
      "pose_mae_dy": 0.09968198835849762,
      "pose_rmse_dtheta": 0.509429931640625,
      "pose_rmse_dx": 0.3036118745803833,
      "pose_rmse_dy": 0.22956202924251556,
      "pose_rmse_mean": 0.3475346267223358,
      "rmse_dtheta": 0.05281028896570206,
      "rmse_dx": 0.03467472642660141,
      "rmse_dy": 0.014304222539067268,
      "rmse_mean": 0.033929746598005295,
      "rotation_flip": 0.01984127052128315,
      "sparse_tokens": 7283.0,
      "step": 1414,
      "turn_loss": 0.37384748458862305,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.06574056866753392,
      "grad_norm": 0.5143003463745117,
      "learning_rate": 9.710109821392257e-06,
      "loss": 0.1486,
      "mae_dtheta": 0.04131738469004631,
      "mae_dx": 0.013774612918496132,
      "mae_dy": 0.006072059273719788,
      "pose_mae_dtheta": 0.29378169775009155,
      "pose_mae_dx": 0.1120460033416748,
      "pose_mae_dy": 0.06939837336540222,
      "pose_rmse_dtheta": 0.5054070353507996,
      "pose_rmse_dx": 0.24059419333934784,
      "pose_rmse_dy": 0.13203714787960052,
      "pose_rmse_mean": 0.29267948865890503,
      "rmse_dtheta": 0.05712325870990753,
      "rmse_dx": 0.025795476511120796,
      "rmse_dy": 0.010057325474917889,
      "rmse_mean": 0.030992019921541214,
      "rotation_flip": 0.008902077563107014,
      "sparse_tokens": 11072.0,
      "step": 1415,
      "turn_loss": 0.34260275959968567,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06578702843337669,
      "grad_norm": 0.6316615343093872,
      "learning_rate": 9.709665984469676e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.014002126641571522,
      "mae_dx": 0.0028225474525243044,
      "mae_dy": 0.004181933123618364,
      "pose_mae_dtheta": 0.09179046005010605,
      "pose_mae_dx": 0.03862910345196724,
      "pose_mae_dy": 0.042442597448825836,
      "pose_rmse_dtheta": 0.19038021564483643,
      "pose_rmse_dx": 0.08499515056610107,
      "pose_rmse_dy": 0.08050394058227539,
      "pose_rmse_mean": 0.1186264380812645,
      "rmse_dtheta": 0.024788374081254005,
      "rmse_dx": 0.006915198173373938,
      "rmse_dy": 0.007650710642337799,
      "rmse_mean": 0.013118094764649868,
      "rotation_flip": 0.005948840174823999,
      "sparse_tokens": 32105.0,
      "step": 1416,
      "turn_loss": 0.12614712119102478,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.06583348819921947,
      "grad_norm": 0.42007380723953247,
      "learning_rate": 9.709221818197626e-06,
      "loss": 0.1218,
      "mae_dtheta": 0.013382881879806519,
      "mae_dx": 0.0031583395320922136,
      "mae_dy": 0.0034499154426157475,
      "pose_mae_dtheta": 0.10390684753656387,
      "pose_mae_dx": 0.04024271294474602,
      "pose_mae_dy": 0.043019577860832214,
      "pose_rmse_dtheta": 0.24787409603595734,
      "pose_rmse_dx": 0.11214856058359146,
      "pose_rmse_dy": 0.10563405603170395,
      "pose_rmse_mean": 0.1552189141511917,
      "rmse_dtheta": 0.02819705195724964,
      "rmse_dx": 0.010172498412430286,
      "rmse_dy": 0.008672901429235935,
      "rmse_mean": 0.015680817887187004,
      "rotation_flip": 0.0018859028350561857,
      "sparse_tokens": 32041.0,
      "step": 1417,
      "turn_loss": 0.13815337419509888,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06587994796506226,
      "grad_norm": 0.6046582460403442,
      "learning_rate": 9.708777322607163e-06,
      "loss": 0.1409,
      "mae_dtheta": 0.012134953401982784,
      "mae_dx": 0.0021004141308367252,
      "mae_dy": 0.0029232280794531107,
      "pose_mae_dtheta": 0.08992905914783478,
      "pose_mae_dx": 0.026154758408665657,
      "pose_mae_dy": 0.0316879078745842,
      "pose_rmse_dtheta": 0.24372175335884094,
      "pose_rmse_dx": 0.06869802623987198,
      "pose_rmse_dy": 0.07383114844560623,
      "pose_rmse_mean": 0.12875030934810638,
      "rmse_dtheta": 0.026805439963936806,
      "rmse_dx": 0.006665200926363468,
      "rmse_dy": 0.006827679928392172,
      "rmse_mean": 0.013432773761451244,
      "rotation_flip": 0.003998223226517439,
      "sparse_tokens": 32073.0,
      "step": 1418,
      "turn_loss": 0.09311738610267639,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.06592640773090504,
      "grad_norm": 0.5022062659263611,
      "learning_rate": 9.708332497729378e-06,
      "loss": 0.1214,
      "mae_dtheta": 0.025373635813593864,
      "mae_dx": 0.012606406584382057,
      "mae_dy": 0.007043160032480955,
      "pose_mae_dtheta": 0.18182960152626038,
      "pose_mae_dx": 0.0845903605222702,
      "pose_mae_dy": 0.081268809735775,
      "pose_rmse_dtheta": 0.3237112760543823,
      "pose_rmse_dx": 0.22821803390979767,
      "pose_rmse_dy": 0.244045689702034,
      "pose_rmse_mean": 0.26532500982284546,
      "rmse_dtheta": 0.04044283553957939,
      "rmse_dx": 0.029275324195623398,
      "rmse_dy": 0.016793105751276016,
      "rmse_mean": 0.028837090358138084,
      "rotation_flip": 0.011272141709923744,
      "sparse_tokens": 11120.0,
      "step": 1419,
      "turn_loss": 0.3059447109699249,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.06597286749674781,
      "grad_norm": 0.49112167954444885,
      "learning_rate": 9.707887343595373e-06,
      "loss": 0.1072,
      "mae_dtheta": 0.010149762034416199,
      "mae_dx": 0.0020817103795707226,
      "mae_dy": 0.002027349779382348,
      "pose_mae_dtheta": 0.0755816400051117,
      "pose_mae_dx": 0.02490113116800785,
      "pose_mae_dy": 0.03399623557925224,
      "pose_rmse_dtheta": 0.17962025105953217,
      "pose_rmse_dx": 0.05980648100376129,
      "pose_rmse_dy": 0.10078074038028717,
      "pose_rmse_mean": 0.11340248584747314,
      "rmse_dtheta": 0.02097783051431179,
      "rmse_dx": 0.006338546052575111,
      "rmse_dy": 0.004529604222625494,
      "rmse_mean": 0.010615326464176178,
      "rotation_flip": 0.006129954941570759,
      "sparse_tokens": 32153.0,
      "step": 1420,
      "turn_loss": 0.0875445008277893,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06601932726259059,
      "grad_norm": 0.6090549230575562,
      "learning_rate": 9.707441860236278e-06,
      "loss": 0.162,
      "mae_dtheta": 0.010868128389120102,
      "mae_dx": 0.0018063557799905539,
      "mae_dy": 0.002022420521825552,
      "pose_mae_dtheta": 0.07638420909643173,
      "pose_mae_dx": 0.021823056042194366,
      "pose_mae_dy": 0.025596320629119873,
      "pose_rmse_dtheta": 0.17389968037605286,
      "pose_rmse_dx": 0.05577358603477478,
      "pose_rmse_dy": 0.05945495888590813,
      "pose_rmse_mean": 0.09637607634067535,
      "rmse_dtheta": 0.02269524522125721,
      "rmse_dx": 0.005525034386664629,
      "rmse_dy": 0.004356663208454847,
      "rmse_mean": 0.010858980938792229,
      "rotation_flip": 0.0036704731173813343,
      "sparse_tokens": 32105.0,
      "step": 1421,
      "turn_loss": 0.09186388552188873,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.06606578702843338,
      "grad_norm": 0.5214745402336121,
      "learning_rate": 9.70699604768325e-06,
      "loss": 0.133,
      "mae_dtheta": 0.030614949762821198,
      "mae_dx": 0.010483074933290482,
      "mae_dy": 0.002855883678421378,
      "pose_mae_dtheta": 0.22008016705513,
      "pose_mae_dx": 0.08325637131929398,
      "pose_mae_dy": 0.033974841237068176,
      "pose_rmse_dtheta": 0.40117815136909485,
      "pose_rmse_dx": 0.18715867400169373,
      "pose_rmse_dy": 0.08451249450445175,
      "pose_rmse_mean": 0.2242830991744995,
      "rmse_dtheta": 0.049160994589328766,
      "rmse_dx": 0.022121980786323547,
      "rmse_dy": 0.006466340739279985,
      "rmse_mean": 0.025916440412402153,
      "rotation_flip": 0.011565150693058968,
      "sparse_tokens": 22836.0,
      "step": 1422,
      "turn_loss": 0.2526527941226959,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.06611224679427616,
      "grad_norm": 0.639255940914154,
      "learning_rate": 9.70654990596746e-06,
      "loss": 0.2005,
      "mae_dtheta": 0.0383356437087059,
      "mae_dx": 0.016404947265982628,
      "mae_dy": 0.004632002208381891,
      "pose_mae_dtheta": 0.2891349792480469,
      "pose_mae_dx": 0.13407224416732788,
      "pose_mae_dy": 0.060718830674886703,
      "pose_rmse_dtheta": 0.5138129591941833,
      "pose_rmse_dx": 0.25762996077537537,
      "pose_rmse_dy": 0.13498297333717346,
      "pose_rmse_mean": 0.3021419644355774,
      "rmse_dtheta": 0.058359865099191666,
      "rmse_dx": 0.029490744695067406,
      "rmse_dy": 0.008353606797754765,
      "rmse_mean": 0.032068073749542236,
      "rotation_flip": 0.01515151560306549,
      "sparse_tokens": 14329.0,
      "step": 1423,
      "turn_loss": 0.27257728576660156,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06615870656011894,
      "grad_norm": 0.6651968955993652,
      "learning_rate": 9.706103435120108e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.007928266189992428,
      "mae_dx": 0.001894942601211369,
      "mae_dy": 0.0014094916405156255,
      "pose_mae_dtheta": 0.05100109800696373,
      "pose_mae_dx": 0.021052377298474312,
      "pose_mae_dy": 0.020671674981713295,
      "pose_rmse_dtheta": 0.11741985380649567,
      "pose_rmse_dx": 0.06476983428001404,
      "pose_rmse_dy": 0.052914950996637344,
      "pose_rmse_mean": 0.07836821675300598,
      "rmse_dtheta": 0.018075276166200638,
      "rmse_dx": 0.0066789560951292515,
      "rmse_dy": 0.0030754273757338524,
      "rmse_mean": 0.009276553057134151,
      "rotation_flip": 0.006441223900765181,
      "sparse_tokens": 32073.0,
      "step": 1424,
      "turn_loss": 0.05754515156149864,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.06620516632596171,
      "grad_norm": 0.8279983401298523,
      "learning_rate": 9.705656635172418e-06,
      "loss": 0.2753,
      "mae_dtheta": 0.04484715312719345,
      "mae_dx": 0.0096851522102952,
      "mae_dy": 0.0038418506737798452,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8279979825019836,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.71060180664062,
      "model/head/act_norm_mean": 100.03763751594387,
      "model/head/act_norm_min": 72.79383087158203,
      "model/head/act_over_embed": 68.7468010680749,
      "model/head/grad_frac": 0.13746626675128937,
      "model/head/grad_norm": 0.11382178962230682,
      "model/head/grad_zero_frac": 0.00016688494361005723,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6802853954081632,
      "model/head/update_ratio": 0.0019805554766207933,
      "model/head/weight_delta": 4.23712158203125,
      "model/head/weight_delta_rel": 0.07433166354894638,
      "model/head/weight_norm": 57.469627380371094,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4123961627483368,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4123961627483368,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4123961627483368,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2834025039543624,
      "model/modality_embedder.encoders.pose/grad_frac": 0.04830620810389519,
      "model/modality_embedder.encoders.pose/grad_norm": 0.039997443556785583,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001302124815993011,
      "model/modality_embedder.encoders.pose/weight_delta": 1.3557119369506836,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.044295333325862885,
      "model/modality_embedder.encoders.pose/weight_norm": 30.717058181762695,
      "model/modality_embedder/grad_frac": 0.04830620810389519,
      "model/modality_embedder/grad_norm": 0.039997443556785583,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.001302124815993011,
      "model/modality_embedder/weight_delta": 1.3557119369506836,
      "model/modality_embedder/weight_delta_rel": 0.044295333325862885,
      "model/modality_embedder/weight_norm": 30.717058181762695,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 69.34432983398438,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.44625141723356,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.226171493530273,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.425274119039562,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08948534727096558,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.07409368455410004,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0026889536529779434,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.7584167718887329,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.027637165039777756,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.554838180541992,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 70.60347747802734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.357390873015873,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.714595794677734,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.051417683275147,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0950123593211174,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07867003977298737,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002705552149564028,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.9353384375572205,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.03240085393190384,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.077259063720703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 72.55430603027344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.02776259313249,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.902158737182617,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.199312767605715,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09522069245576859,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07884254306554794,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0026276500429958105,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 0.9879067540168762,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.033172059804201126,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.004962921142578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 73.73147583007812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.010867144476837,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.461766242980957,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.562120781406875,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09637238085269928,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07979613542556763,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0027118104044348,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.8437416553497314,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.028835086151957512,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.425411224365234,
      "model/normalizer/grad_frac": 0.36792850494384766,
      "model/normalizer/grad_norm": 0.30464404821395874,
      "model/normalizer/grad_zero_frac": 0.00022689378238283098,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003911795560270548,
      "model/normalizer/weight_delta": 1.8149187564849854,
      "model/normalizer/weight_delta_rel": 0.023375103250145912,
      "model/normalizer/weight_norm": 77.8783187866211,
      "pose_mae_dtheta": 0.36620667576789856,
      "pose_mae_dx": 0.08532644063234329,
      "pose_mae_dy": 0.04589465633034706,
      "pose_rmse_dtheta": 0.5572260618209839,
      "pose_rmse_dx": 0.18701015412807465,
      "pose_rmse_dy": 0.13163530826568604,
      "pose_rmse_mean": 0.29195719957351685,
      "rmse_dtheta": 0.06088675931096077,
      "rmse_dx": 0.020512117072939873,
      "rmse_dy": 0.008798591792583466,
      "rmse_mean": 0.03006582334637642,
      "rotation_flip": 0.019920319318771362,
      "sparse_tokens": 13166.0,
      "step": 1425,
      "turn_loss": 0.3069252371788025,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.0662516260918045,
      "grad_norm": 0.4230633080005646,
      "learning_rate": 9.705209506155635e-06,
      "loss": 0.1772,
      "mae_dtheta": 0.003978230524808168,
      "mae_dx": 0.0013512487057596445,
      "mae_dy": 0.0006510753883048892,
      "pose_mae_dtheta": 0.027061110362410545,
      "pose_mae_dx": 0.012213561683893204,
      "pose_mae_dy": 0.008889107033610344,
      "pose_rmse_dtheta": 0.08487771451473236,
      "pose_rmse_dx": 0.03769854083657265,
      "pose_rmse_dy": 0.02183573506772518,
      "pose_rmse_mean": 0.04813732951879501,
      "rmse_dtheta": 0.014598417095839977,
      "rmse_dx": 0.0047509209252893925,
      "rmse_dy": 0.0014428796712309122,
      "rmse_mean": 0.006930739618837833,
      "rotation_flip": 0.0017271157121285796,
      "sparse_tokens": 32073.0,
      "step": 1426,
      "turn_loss": 0.035006262362003326,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.06629808585764728,
      "grad_norm": 1.0759131908416748,
      "learning_rate": 9.704762048101024e-06,
      "loss": 0.258,
      "mae_dtheta": 0.028618499636650085,
      "mae_dx": 0.01171562448143959,
      "mae_dy": 0.005580130033195019,
      "pose_mae_dtheta": 0.23873469233512878,
      "pose_mae_dx": 0.09998268634080887,
      "pose_mae_dy": 0.06757200509309769,
      "pose_rmse_dtheta": 0.46999284625053406,
      "pose_rmse_dx": 0.23796147108078003,
      "pose_rmse_dy": 0.13388332724571228,
      "pose_rmse_mean": 0.2806125581264496,
      "rmse_dtheta": 0.04754304885864258,
      "rmse_dx": 0.02411353588104248,
      "rmse_dy": 0.010893043130636215,
      "rmse_mean": 0.027516543865203857,
      "rotation_flip": 0.013259668834507465,
      "sparse_tokens": 19380.0,
      "step": 1427,
      "turn_loss": 0.29650434851646423,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06634454562349006,
      "grad_norm": 0.6735681295394897,
      "learning_rate": 9.704314261039879e-06,
      "loss": 0.1588,
      "mae_dtheta": 0.01256964448839426,
      "mae_dx": 0.0022900747135281563,
      "mae_dy": 0.002729318104684353,
      "pose_mae_dtheta": 0.09150127321481705,
      "pose_mae_dx": 0.026707975193858147,
      "pose_mae_dy": 0.031248081475496292,
      "pose_rmse_dtheta": 0.24209335446357727,
      "pose_rmse_dx": 0.06593580543994904,
      "pose_rmse_dy": 0.08336786180734634,
      "pose_rmse_mean": 0.13046568632125854,
      "rmse_dtheta": 0.029096486046910286,
      "rmse_dx": 0.006443764548748732,
      "rmse_dy": 0.006605162750929594,
      "rmse_mean": 0.014048471115529537,
      "rotation_flip": 0.009062075056135654,
      "sparse_tokens": 32105.0,
      "step": 1428,
      "turn_loss": 0.099476158618927,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25959.0,
      "epoch": 0.06639100538933283,
      "grad_norm": 1.0652546882629395,
      "learning_rate": 9.703866145003512e-06,
      "loss": 0.3049,
      "mae_dtheta": 0.03829560801386833,
      "mae_dx": 0.016666993498802185,
      "mae_dy": 0.005046239122748375,
      "pose_mae_dtheta": 0.312842458486557,
      "pose_mae_dx": 0.14119631052017212,
      "pose_mae_dy": 0.060983531177043915,
      "pose_rmse_dtheta": 0.535004198551178,
      "pose_rmse_dx": 0.300647109746933,
      "pose_rmse_dy": 0.14662694931030273,
      "pose_rmse_mean": 0.32742607593536377,
      "rmse_dtheta": 0.05634322389960289,
      "rmse_dx": 0.030505111441016197,
      "rmse_dy": 0.01163159217685461,
      "rmse_mean": 0.03282664343714714,
      "rotation_flip": 0.01764705963432789,
      "sparse_tokens": 20550.0,
      "step": 1429,
      "turn_loss": 0.3228538930416107,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06643746515517562,
      "grad_norm": 0.5408039689064026,
      "learning_rate": 9.703417700023262e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.013612058945000172,
      "mae_dx": 0.0038072552997618914,
      "mae_dy": 0.003600056516006589,
      "pose_mae_dtheta": 0.09544219076633453,
      "pose_mae_dx": 0.03765895217657089,
      "pose_mae_dy": 0.04469849914312363,
      "pose_rmse_dtheta": 0.19791564345359802,
      "pose_rmse_dx": 0.0943024605512619,
      "pose_rmse_dy": 0.10980642586946487,
      "pose_rmse_mean": 0.13400816917419434,
      "rmse_dtheta": 0.02662547491490841,
      "rmse_dx": 0.010472884401679039,
      "rmse_dy": 0.00868794322013855,
      "rmse_mean": 0.015262100845575333,
      "rotation_flip": 0.003137606428936124,
      "sparse_tokens": 32073.0,
      "step": 1430,
      "turn_loss": 0.14793355762958527,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0664839249210184,
      "grad_norm": 0.4544384777545929,
      "learning_rate": 9.702968926130486e-06,
      "loss": 0.107,
      "mae_dtheta": 0.009760058484971523,
      "mae_dx": 0.001460272236727178,
      "mae_dy": 0.0021002227440476418,
      "pose_mae_dtheta": 0.06843723356723785,
      "pose_mae_dx": 0.018133731558918953,
      "pose_mae_dy": 0.02701535075902939,
      "pose_rmse_dtheta": 0.1714298576116562,
      "pose_rmse_dx": 0.04520699009299278,
      "pose_rmse_dy": 0.062371015548706055,
      "pose_rmse_mean": 0.09300261735916138,
      "rmse_dtheta": 0.020680680871009827,
      "rmse_dx": 0.004598833154886961,
      "rmse_dy": 0.004169995430856943,
      "rmse_mean": 0.009816503152251244,
      "rotation_flip": 0.003568242536857724,
      "sparse_tokens": 32089.0,
      "step": 1431,
      "turn_loss": 0.07081437855958939,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.06653038468686118,
      "grad_norm": 0.44718316197395325,
      "learning_rate": 9.702519823356568e-06,
      "loss": 0.1493,
      "mae_dtheta": 0.04796299710869789,
      "mae_dx": 0.016093576326966286,
      "mae_dy": 0.007892713882029057,
      "pose_mae_dtheta": 0.39740467071533203,
      "pose_mae_dx": 0.14517773687839508,
      "pose_mae_dy": 0.09052100777626038,
      "pose_rmse_dtheta": 0.631955623626709,
      "pose_rmse_dx": 0.2753509283065796,
      "pose_rmse_dy": 0.22596164047718048,
      "pose_rmse_mean": 0.3777560889720917,
      "rmse_dtheta": 0.06769831478595734,
      "rmse_dx": 0.028087344020605087,
      "rmse_dy": 0.018748940899968147,
      "rmse_mean": 0.038178201764822006,
      "rotation_flip": 0.014718614518642426,
      "sparse_tokens": 18912.0,
      "step": 1432,
      "turn_loss": 0.38275742530822754,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.06657684445270395,
      "grad_norm": 0.5370511412620544,
      "learning_rate": 9.702070391732919e-06,
      "loss": 0.0892,
      "mae_dtheta": 0.012623368762433529,
      "mae_dx": 0.002381995553150773,
      "mae_dy": 0.0025109336711466312,
      "pose_mae_dtheta": 0.08349278569221497,
      "pose_mae_dx": 0.027055663987994194,
      "pose_mae_dy": 0.029034094884991646,
      "pose_rmse_dtheta": 0.22448205947875977,
      "pose_rmse_dx": 0.07039213925600052,
      "pose_rmse_dy": 0.06406340003013611,
      "pose_rmse_mean": 0.1196458637714386,
      "rmse_dtheta": 0.02657867781817913,
      "rmse_dx": 0.006944151595234871,
      "rmse_dy": 0.0049106646329164505,
      "rmse_mean": 0.012811164371669292,
      "rotation_flip": 0.00600375235080719,
      "sparse_tokens": 32121.0,
      "step": 1433,
      "turn_loss": 0.09818390756845474,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25313.0,
      "epoch": 0.06662330421854674,
      "grad_norm": 0.45860031247138977,
      "learning_rate": 9.70162063129096e-06,
      "loss": 0.1382,
      "mae_dtheta": 0.03175761550664902,
      "mae_dx": 0.012396651320159435,
      "mae_dy": 0.006228073034435511,
      "pose_mae_dtheta": 0.24520045518875122,
      "pose_mae_dx": 0.09481898695230484,
      "pose_mae_dy": 0.06861544400453568,
      "pose_rmse_dtheta": 0.4266241490840912,
      "pose_rmse_dx": 0.2051645964384079,
      "pose_rmse_dy": 0.15611158311367035,
      "pose_rmse_mean": 0.26263344287872314,
      "rmse_dtheta": 0.04919591546058655,
      "rmse_dx": 0.024246670305728912,
      "rmse_dy": 0.012676703743636608,
      "rmse_mean": 0.02870642952620983,
      "rotation_flip": 0.012820512987673283,
      "sparse_tokens": 20891.0,
      "step": 1434,
      "turn_loss": 0.25897249579429626,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06666976398438952,
      "grad_norm": 0.7046703696250916,
      "learning_rate": 9.701170542062149e-06,
      "loss": 0.1637,
      "mae_dtheta": 0.0171829704195261,
      "mae_dx": 0.0030400780960917473,
      "mae_dy": 0.004513606429100037,
      "pose_mae_dtheta": 0.12759654223918915,
      "pose_mae_dx": 0.04697662964463234,
      "pose_mae_dy": 0.05663856863975525,
      "pose_rmse_dtheta": 0.23727834224700928,
      "pose_rmse_dx": 0.13014352321624756,
      "pose_rmse_dy": 0.12313135713338852,
      "pose_rmse_mean": 0.16351774334907532,
      "rmse_dtheta": 0.02881615050137043,
      "rmse_dx": 0.00902541819959879,
      "rmse_dy": 0.00979477446526289,
      "rmse_mean": 0.01587878167629242,
      "rotation_flip": 0.009928107261657715,
      "sparse_tokens": 32073.0,
      "step": 1435,
      "turn_loss": 0.1428079754114151,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0667162237502323,
      "grad_norm": 0.43164148926734924,
      "learning_rate": 9.700720124077957e-06,
      "loss": 0.1363,
      "mae_dtheta": 0.013616124168038368,
      "mae_dx": 0.002193757565692067,
      "mae_dy": 0.0037894919514656067,
      "pose_mae_dtheta": 0.0912998765707016,
      "pose_mae_dx": 0.029582006856799126,
      "pose_mae_dy": 0.04095517843961716,
      "pose_rmse_dtheta": 0.16010889410972595,
      "pose_rmse_dx": 0.06302995979785919,
      "pose_rmse_dy": 0.08347589522600174,
      "pose_rmse_mean": 0.10220491886138916,
      "rmse_dtheta": 0.022972848266363144,
      "rmse_dx": 0.005560407415032387,
      "rmse_dy": 0.0070858183316886425,
      "rmse_mean": 0.011873024515807629,
      "rotation_flip": 0.00590796023607254,
      "sparse_tokens": 32121.0,
      "step": 1436,
      "turn_loss": 0.11966520547866821,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37198.0,
      "epoch": 0.06676268351607507,
      "grad_norm": 0.559579074382782,
      "learning_rate": 9.700269377369883e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.03738944232463837,
      "mae_dx": 0.014758622273802757,
      "mae_dy": 0.0042938231490552425,
      "pose_mae_dtheta": 0.2916755974292755,
      "pose_mae_dx": 0.12595157325267792,
      "pose_mae_dy": 0.05076415091753006,
      "pose_rmse_dtheta": 0.5250763893127441,
      "pose_rmse_dx": 0.26416751742362976,
      "pose_rmse_dy": 0.12512004375457764,
      "pose_rmse_mean": 0.3047879934310913,
      "rmse_dtheta": 0.05655708909034729,
      "rmse_dx": 0.02837948128581047,
      "rmse_dy": 0.009029660373926163,
      "rmse_mean": 0.03132207691669464,
      "rotation_flip": 0.017321016639471054,
      "sparse_tokens": 29369.0,
      "step": 1437,
      "turn_loss": 0.2644340693950653,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.06680914328191787,
      "grad_norm": 0.6296324729919434,
      "learning_rate": 9.69981830196945e-06,
      "loss": 0.1907,
      "mae_dtheta": 0.03750582039356232,
      "mae_dx": 0.0092640221118927,
      "mae_dy": 0.0038186577148735523,
      "pose_mae_dtheta": 0.28477105498313904,
      "pose_mae_dx": 0.06923819333314896,
      "pose_mae_dy": 0.03736230358481407,
      "pose_rmse_dtheta": 0.5111801624298096,
      "pose_rmse_dx": 0.16274046897888184,
      "pose_rmse_dy": 0.08569449931383133,
      "pose_rmse_mean": 0.2532050609588623,
      "rmse_dtheta": 0.057311903685331345,
      "rmse_dx": 0.020488157868385315,
      "rmse_dy": 0.007518382743000984,
      "rmse_mean": 0.028439482674002647,
      "rotation_flip": 0.012278308160603046,
      "sparse_tokens": 23768.0,
      "step": 1438,
      "turn_loss": 0.27875712513923645,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.06685560304776064,
      "grad_norm": 0.4536920189857483,
      "learning_rate": 9.6993668979082e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.04025775194168091,
      "mae_dx": 0.011107580736279488,
      "mae_dy": 0.005029111169278622,
      "pose_mae_dtheta": 0.3602631986141205,
      "pose_mae_dx": 0.08722829818725586,
      "pose_mae_dy": 0.05366690829396248,
      "pose_rmse_dtheta": 0.5652317404747009,
      "pose_rmse_dx": 0.18808969855308533,
      "pose_rmse_dy": 0.12867605686187744,
      "pose_rmse_mean": 0.29399916529655457,
      "rmse_dtheta": 0.05655006319284439,
      "rmse_dx": 0.021972915157675743,
      "rmse_dy": 0.009413439780473709,
      "rmse_mean": 0.029312139376997948,
      "rotation_flip": 0.0258397925645113,
      "sparse_tokens": 21198.0,
      "step": 1439,
      "turn_loss": 0.3254084885120392,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 27817.0,
      "epoch": 0.06690206281360342,
      "grad_norm": 0.8067123889923096,
      "learning_rate": 9.698915165217702e-06,
      "loss": 0.2782,
      "mae_dtheta": 0.0505492128431797,
      "mae_dx": 0.01591627672314644,
      "mae_dy": 0.005472383927553892,
      "pose_mae_dtheta": 0.44430387020111084,
      "pose_mae_dx": 0.1255052387714386,
      "pose_mae_dy": 0.05094947665929794,
      "pose_rmse_dtheta": 0.6860451102256775,
      "pose_rmse_dx": 0.2474416196346283,
      "pose_rmse_dy": 0.12539242208003998,
      "pose_rmse_mean": 0.3529597222805023,
      "rmse_dtheta": 0.06891442090272903,
      "rmse_dx": 0.02875174582004547,
      "rmse_dy": 0.01287040114402771,
      "rmse_mean": 0.03684552386403084,
      "rotation_flip": 0.01435750164091587,
      "sparse_tokens": 22812.0,
      "step": 1440,
      "turn_loss": 0.38671958446502686,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.0669485225794462,
      "grad_norm": 0.608569860458374,
      "learning_rate": 9.698463103929542e-06,
      "loss": 0.1629,
      "mae_dtheta": 0.04453697055578232,
      "mae_dx": 0.016500107944011688,
      "mae_dy": 0.004399158991873264,
      "pose_mae_dtheta": 0.3650151789188385,
      "pose_mae_dx": 0.1333533525466919,
      "pose_mae_dy": 0.04689325764775276,
      "pose_rmse_dtheta": 0.6195476055145264,
      "pose_rmse_dx": 0.28357675671577454,
      "pose_rmse_dy": 0.10060743987560272,
      "pose_rmse_mean": 0.3345772624015808,
      "rmse_dtheta": 0.06376723945140839,
      "rmse_dx": 0.029682638123631477,
      "rmse_dy": 0.00866340845823288,
      "rmse_mean": 0.0340377613902092,
      "rotation_flip": 0.015625,
      "sparse_tokens": 22585.0,
      "step": 1441,
      "turn_loss": 0.304660439491272,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.06699498234528899,
      "grad_norm": 1.090289831161499,
      "learning_rate": 9.698010714075337e-06,
      "loss": 0.3006,
      "mae_dtheta": 0.018540365621447563,
      "mae_dx": 0.01712798699736595,
      "mae_dy": 0.0053782835602760315,
      "pose_mae_dtheta": 0.0940713956952095,
      "pose_mae_dx": 0.14971648156642914,
      "pose_mae_dy": 0.05690581724047661,
      "pose_rmse_dtheta": 0.15990813076496124,
      "pose_rmse_dx": 0.23983553051948547,
      "pose_rmse_dy": 0.10245513916015625,
      "pose_rmse_mean": 0.16739961504936218,
      "rmse_dtheta": 0.02912692353129387,
      "rmse_dx": 0.027545278891921043,
      "rmse_dy": 0.008097994141280651,
      "rmse_mean": 0.021590065211057663,
      "rotation_flip": 0.0,
      "sparse_tokens": 2971.0,
      "step": 1442,
      "turn_loss": 0.40725839138031006,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.06704144211113176,
      "grad_norm": 0.8948974609375,
      "learning_rate": 9.697557995686722e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.01123817265033722,
      "mae_dx": 0.0024133219849318266,
      "mae_dy": 0.002382905688136816,
      "pose_mae_dtheta": 0.0774667039513588,
      "pose_mae_dx": 0.030419299378991127,
      "pose_mae_dy": 0.03397107869386673,
      "pose_rmse_dtheta": 0.16407687962055206,
      "pose_rmse_dx": 0.08920043706893921,
      "pose_rmse_dy": 0.09083899110555649,
      "pose_rmse_mean": 0.11470543593168259,
      "rmse_dtheta": 0.02222503535449505,
      "rmse_dx": 0.008478574454784393,
      "rmse_dy": 0.005184434819966555,
      "rmse_mean": 0.011962682008743286,
      "rotation_flip": 0.004564473405480385,
      "sparse_tokens": 32041.0,
      "step": 1443,
      "turn_loss": 0.10660938173532486,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.06708790187697454,
      "grad_norm": 0.7761220932006836,
      "learning_rate": 9.697104948795353e-06,
      "loss": 0.2039,
      "mae_dtheta": 0.03533622995018959,
      "mae_dx": 0.01257307454943657,
      "mae_dy": 0.003661031136289239,
      "pose_mae_dtheta": 0.3194633722305298,
      "pose_mae_dx": 0.091831274330616,
      "pose_mae_dy": 0.04587778076529503,
      "pose_rmse_dtheta": 0.5550742149353027,
      "pose_rmse_dx": 0.1915271133184433,
      "pose_rmse_dy": 0.09921729564666748,
      "pose_rmse_mean": 0.2819395661354065,
      "rmse_dtheta": 0.05384340137243271,
      "rmse_dx": 0.023291997611522675,
      "rmse_dy": 0.0070885540917515755,
      "rmse_mean": 0.028074651956558228,
      "rotation_flip": 0.011379800736904144,
      "sparse_tokens": 12250.0,
      "step": 1444,
      "turn_loss": 0.2719007134437561,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.06713436164281732,
      "grad_norm": 0.6357073187828064,
      "learning_rate": 9.696651573432915e-06,
      "loss": 0.1614,
      "mae_dtheta": 0.02882462926208973,
      "mae_dx": 0.0075696962885558605,
      "mae_dy": 0.003319881623610854,
      "pose_mae_dtheta": 0.244785875082016,
      "pose_mae_dx": 0.054380595684051514,
      "pose_mae_dy": 0.05327078700065613,
      "pose_rmse_dtheta": 0.4970337748527527,
      "pose_rmse_dx": 0.12560144066810608,
      "pose_rmse_dy": 0.1622404307126999,
      "pose_rmse_mean": 0.2616252303123474,
      "rmse_dtheta": 0.04930715262889862,
      "rmse_dx": 0.018822364509105682,
      "rmse_dy": 0.007448799442499876,
      "rmse_mean": 0.02519277296960354,
      "rotation_flip": 0.009933775290846825,
      "sparse_tokens": 5553.0,
      "step": 1445,
      "turn_loss": 0.13720466196537018,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 11990.0,
      "epoch": 0.0671808214086601,
      "grad_norm": 0.6006938219070435,
      "learning_rate": 9.696197869631111e-06,
      "loss": 0.1816,
      "mae_dtheta": 0.0419260673224926,
      "mae_dx": 0.019314119592308998,
      "mae_dy": 0.009724688716232777,
      "pose_mae_dtheta": 0.30458250641822815,
      "pose_mae_dx": 0.15150336921215057,
      "pose_mae_dy": 0.11058242619037628,
      "pose_rmse_dtheta": 0.516555666923523,
      "pose_rmse_dx": 0.2928309738636017,
      "pose_rmse_dy": 0.21665968000888824,
      "pose_rmse_mean": 0.34201544523239136,
      "rmse_dtheta": 0.05739814415574074,
      "rmse_dx": 0.03304990008473396,
      "rmse_dy": 0.01657489500939846,
      "rmse_mean": 0.0356743149459362,
      "rotation_flip": 0.024115756154060364,
      "sparse_tokens": 10123.0,
      "step": 1446,
      "turn_loss": 0.2895183563232422,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.06722728117450288,
      "grad_norm": 0.818480372428894,
      "learning_rate": 9.69574383742167e-06,
      "loss": 0.1761,
      "mae_dtheta": 0.04607878252863884,
      "mae_dx": 0.01426703017205,
      "mae_dy": 0.007303902413696051,
      "pose_mae_dtheta": 0.38358592987060547,
      "pose_mae_dx": 0.11775723099708557,
      "pose_mae_dy": 0.09406736493110657,
      "pose_rmse_dtheta": 0.6077685952186584,
      "pose_rmse_dx": 0.2636108696460724,
      "pose_rmse_dy": 0.21342039108276367,
      "pose_rmse_mean": 0.36159998178482056,
      "rmse_dtheta": 0.06438083201646805,
      "rmse_dx": 0.027970999479293823,
      "rmse_dy": 0.013681987300515175,
      "rmse_mean": 0.03534460812807083,
      "rotation_flip": 0.013661202043294907,
      "sparse_tokens": 17929.0,
      "step": 1447,
      "turn_loss": 0.31741076707839966,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.06727374094034566,
      "grad_norm": 0.5184829235076904,
      "learning_rate": 9.695289476836342e-06,
      "loss": 0.1527,
      "mae_dtheta": 0.03277738392353058,
      "mae_dx": 0.011143961921334267,
      "mae_dy": 0.005540197249501944,
      "pose_mae_dtheta": 0.2516239285469055,
      "pose_mae_dx": 0.1133277490735054,
      "pose_mae_dy": 0.06575019657611847,
      "pose_rmse_dtheta": 0.4142622649669647,
      "pose_rmse_dx": 0.24673691391944885,
      "pose_rmse_dy": 0.15292905271053314,
      "pose_rmse_mean": 0.27130943536758423,
      "rmse_dtheta": 0.04824293777346611,
      "rmse_dx": 0.02269360050559044,
      "rmse_dy": 0.0115147540345788,
      "rmse_mean": 0.02748376503586769,
      "rotation_flip": 0.022309711202979088,
      "sparse_tokens": 13241.0,
      "step": 1448,
      "turn_loss": 0.27145206928253174,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.06732020070618844,
      "grad_norm": 0.513197660446167,
      "learning_rate": 9.6948347879069e-06,
      "loss": 0.1301,
      "mae_dtheta": 0.03790363296866417,
      "mae_dx": 0.01582336612045765,
      "mae_dy": 0.005474175326526165,
      "pose_mae_dtheta": 0.2950235605239868,
      "pose_mae_dx": 0.11525271087884903,
      "pose_mae_dy": 0.05488113313913345,
      "pose_rmse_dtheta": 0.5234524011611938,
      "pose_rmse_dx": 0.2568681538105011,
      "pose_rmse_dy": 0.1258401870727539,
      "pose_rmse_mean": 0.3020535707473755,
      "rmse_dtheta": 0.057315193116664886,
      "rmse_dx": 0.02944297157227993,
      "rmse_dy": 0.01152660883963108,
      "rmse_mean": 0.0327615924179554,
      "rotation_flip": 0.01833740808069706,
      "sparse_tokens": 13904.0,
      "step": 1449,
      "turn_loss": 0.2962159812450409,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.06736666047203121,
      "grad_norm": 0.753583550453186,
      "learning_rate": 9.694379770665142e-06,
      "loss": 0.2153,
      "mae_dtheta": 0.01597350649535656,
      "mae_dx": 0.005023155361413956,
      "mae_dy": 0.007382318377494812,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7535836696624756,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.7557373046875,
      "model/head/act_norm_mean": 97.39037839330808,
      "model/head/act_norm_min": 57.075592041015625,
      "model/head/act_over_embed": 66.9275798149692,
      "model/head/grad_frac": 0.11702952533960342,
      "model/head/grad_norm": 0.08819153904914856,
      "model/head/grad_zero_frac": 0.00017227856733370572,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6844075520833334,
      "model/head/update_ratio": 0.0015343147097155452,
      "model/head/weight_delta": 4.282110214233398,
      "model/head/weight_delta_rel": 0.07512089610099792,
      "model/head/weight_norm": 57.47943115234375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41263720393180847,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4125905265974686,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4125097692012787,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28353607261114877,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06033489480614662,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04546739161014557,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5342607123362445,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001480098464526236,
      "model/modality_embedder.encoders.pose/weight_delta": 1.3727904558181763,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.044853344559669495,
      "model/modality_embedder.encoders.pose/weight_norm": 30.719167709350586,
      "model/modality_embedder/grad_frac": 0.06033489480614662,
      "model/modality_embedder/grad_norm": 0.04546739161014557,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5342607123362445,
      "model/modality_embedder/update_ratio": 0.001480098464526236,
      "model/modality_embedder/weight_delta": 1.3727904558181763,
      "model/modality_embedder/weight_delta_rel": 0.044853344559669495,
      "model/modality_embedder/weight_norm": 30.719167709350586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.00160217285156,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.31357974587141,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.959718704223633,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.334100904387736,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08565471321344376,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06454799324274063,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.00234234775416553,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.7716612815856934,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.028119802474975586,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.556964874267578,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.8672866821289,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.36414241622575,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.171916961669922,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.056057406977917,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08470188826322556,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06382995843887329,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0021949021611362696,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.9508264660835266,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.032937370240688324,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.081005096435547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.6556625366211,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.36738165383999,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.540745735168457,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.432702165687648,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.093172587454319,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07021334022283554,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0023397435434162617,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.0046368837356567,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.033733826130628586,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.008989334106445,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.5146484375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.477307800224466,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.77384090423584,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.882663166922864,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11176835000514984,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08422680199146271,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0028620706871151924,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.8580591678619385,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.02932438999414444,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.42862319946289,
      "model/normalizer/grad_frac": 0.44567787647247314,
      "model/normalizer/grad_norm": 0.3358555734157562,
      "model/normalizer/grad_zero_frac": 0.00014299034955911338,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004312329459935427,
      "model/normalizer/weight_delta": 1.845683217048645,
      "model/normalizer/weight_delta_rel": 0.02377133071422577,
      "model/normalizer/weight_norm": 77.88262939453125,
      "pose_mae_dtheta": 0.12172624468803406,
      "pose_mae_dx": 0.05841129273176193,
      "pose_mae_dy": 0.05935205519199371,
      "pose_rmse_dtheta": 0.23767374455928802,
      "pose_rmse_dx": 0.13431210815906525,
      "pose_rmse_dy": 0.14816614985466003,
      "pose_rmse_mean": 0.17338399589061737,
      "rmse_dtheta": 0.028809648007154465,
      "rmse_dx": 0.010684816166758537,
      "rmse_dy": 0.014880185015499592,
      "rmse_mean": 0.018124882131814957,
      "rotation_flip": 0.007655502296984196,
      "sparse_tokens": 32153.0,
      "step": 1450,
      "turn_loss": 0.17845754325389862,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.067413120237874,
      "grad_norm": 0.5843371152877808,
      "learning_rate": 9.693924425142886e-06,
      "loss": 0.1785,
      "mae_dtheta": 0.03945137560367584,
      "mae_dx": 0.010095811448991299,
      "mae_dy": 0.003693622536957264,
      "pose_mae_dtheta": 0.3173264265060425,
      "pose_mae_dx": 0.06404650211334229,
      "pose_mae_dy": 0.03761262446641922,
      "pose_rmse_dtheta": 0.5485045313835144,
      "pose_rmse_dx": 0.15685419738292694,
      "pose_rmse_dy": 0.1065308228135109,
      "pose_rmse_mean": 0.2706298828125,
      "rmse_dtheta": 0.060034897178411484,
      "rmse_dx": 0.02156444825232029,
      "rmse_dy": 0.008578360080718994,
      "rmse_mean": 0.03005923703312874,
      "rotation_flip": 0.015681544318795204,
      "sparse_tokens": 12459.0,
      "step": 1451,
      "turn_loss": 0.25865843892097473,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.06745958000371678,
      "grad_norm": 0.45020073652267456,
      "learning_rate": 9.693468751371977e-06,
      "loss": 0.1293,
      "mae_dtheta": 0.0378090962767601,
      "mae_dx": 0.014824183657765388,
      "mae_dy": 0.0033832392655313015,
      "pose_mae_dtheta": 0.28816109895706177,
      "pose_mae_dx": 0.10690100491046906,
      "pose_mae_dy": 0.038424283266067505,
      "pose_rmse_dtheta": 0.446149080991745,
      "pose_rmse_dx": 0.2769129276275635,
      "pose_rmse_dy": 0.0884394645690918,
      "pose_rmse_mean": 0.270500510931015,
      "rmse_dtheta": 0.055454153567552567,
      "rmse_dx": 0.029598549008369446,
      "rmse_dy": 0.007047516759485006,
      "rmse_mean": 0.030700072646141052,
      "rotation_flip": 0.0039840638637542725,
      "sparse_tokens": 4303.0,
      "step": 1452,
      "turn_loss": 0.25730329751968384,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06750603976955956,
      "grad_norm": 0.5847024321556091,
      "learning_rate": 9.69301274938428e-06,
      "loss": 0.1682,
      "mae_dtheta": 0.01171362865716219,
      "mae_dx": 0.0024726111441850662,
      "mae_dy": 0.0025486252270638943,
      "pose_mae_dtheta": 0.08250480890274048,
      "pose_mae_dx": 0.02635136805474758,
      "pose_mae_dy": 0.03593504801392555,
      "pose_rmse_dtheta": 0.18267841637134552,
      "pose_rmse_dx": 0.06669715791940689,
      "pose_rmse_dy": 0.09015347808599472,
      "pose_rmse_mean": 0.1131763607263565,
      "rmse_dtheta": 0.0226547010242939,
      "rmse_dx": 0.008387803100049496,
      "rmse_dy": 0.0051432326436042786,
      "rmse_mean": 0.012061912566423416,
      "rotation_flip": 0.00871459674090147,
      "sparse_tokens": 32073.0,
      "step": 1453,
      "turn_loss": 0.08986620604991913,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06755249953540234,
      "grad_norm": 0.43006229400634766,
      "learning_rate": 9.69255641921168e-06,
      "loss": 0.1182,
      "mae_dtheta": 0.011088689789175987,
      "mae_dx": 0.0024710707366466522,
      "mae_dy": 0.0024149601813405752,
      "pose_mae_dtheta": 0.08192483335733414,
      "pose_mae_dx": 0.026538051664829254,
      "pose_mae_dy": 0.03154272213578224,
      "pose_rmse_dtheta": 0.20947948098182678,
      "pose_rmse_dx": 0.076237753033638,
      "pose_rmse_dy": 0.08229875564575195,
      "pose_rmse_mean": 0.12267200648784637,
      "rmse_dtheta": 0.02418956533074379,
      "rmse_dx": 0.00830022245645523,
      "rmse_dy": 0.005332484841346741,
      "rmse_mean": 0.012607424519956112,
      "rotation_flip": 0.009043927304446697,
      "sparse_tokens": 32105.0,
      "step": 1454,
      "turn_loss": 0.09210406243801117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27904.0,
      "epoch": 0.06759895930124513,
      "grad_norm": 0.5035609006881714,
      "learning_rate": 9.692099760886094e-06,
      "loss": 0.1322,
      "mae_dtheta": 0.04055027291178703,
      "mae_dx": 0.012375573627650738,
      "mae_dy": 0.005714613012969494,
      "pose_mae_dtheta": 0.32833150029182434,
      "pose_mae_dx": 0.10237352550029755,
      "pose_mae_dy": 0.06699804216623306,
      "pose_rmse_dtheta": 0.5654188394546509,
      "pose_rmse_dx": 0.24695006012916565,
      "pose_rmse_dy": 0.15195363759994507,
      "pose_rmse_mean": 0.32144084572792053,
      "rmse_dtheta": 0.06050301715731621,
      "rmse_dx": 0.02600252814590931,
      "rmse_dy": 0.012233812361955643,
      "rmse_mean": 0.03291311860084534,
      "rotation_flip": 0.01603849232196808,
      "sparse_tokens": 22081.0,
      "step": 1455,
      "turn_loss": 0.3048711121082306,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.0676454190670879,
      "grad_norm": 0.5466853976249695,
      "learning_rate": 9.69164277443945e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.01055648922920227,
      "mae_dx": 0.0020983244758099318,
      "mae_dy": 0.0034513594582676888,
      "pose_mae_dtheta": 0.08347649872303009,
      "pose_mae_dx": 0.028665678575634956,
      "pose_mae_dy": 0.04615969583392143,
      "pose_rmse_dtheta": 0.20206335186958313,
      "pose_rmse_dx": 0.07159411907196045,
      "pose_rmse_dy": 0.15334337949752808,
      "pose_rmse_mean": 0.14233362674713135,
      "rmse_dtheta": 0.02394072525203228,
      "rmse_dx": 0.00608859583735466,
      "rmse_dy": 0.010373380035161972,
      "rmse_mean": 0.013467567972838879,
      "rotation_flip": 0.0018115942366421223,
      "sparse_tokens": 32073.0,
      "step": 1456,
      "turn_loss": 0.0916999951004982,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26849.0,
      "epoch": 0.06769187883293068,
      "grad_norm": 0.6930028796195984,
      "learning_rate": 9.69118545990371e-06,
      "loss": 0.1953,
      "mae_dtheta": 0.04339264705777168,
      "mae_dx": 0.015358669683337212,
      "mae_dy": 0.0062011959962546825,
      "pose_mae_dtheta": 0.34621885418891907,
      "pose_mae_dx": 0.12357604503631592,
      "pose_mae_dy": 0.06850922107696533,
      "pose_rmse_dtheta": 0.5240086317062378,
      "pose_rmse_dx": 0.2534380853176117,
      "pose_rmse_dy": 0.14639054238796234,
      "pose_rmse_mean": 0.30794578790664673,
      "rmse_dtheta": 0.05969640985131264,
      "rmse_dx": 0.02734183333814144,
      "rmse_dy": 0.013074616901576519,
      "rmse_mean": 0.03337095305323601,
      "rotation_flip": 0.007898894138634205,
      "sparse_tokens": 20938.0,
      "step": 1457,
      "turn_loss": 0.4085530638694763,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.06773833859877346,
      "grad_norm": 0.6639055013656616,
      "learning_rate": 9.690727817310853e-06,
      "loss": 0.2017,
      "mae_dtheta": 0.03657374158501625,
      "mae_dx": 0.01689535193145275,
      "mae_dy": 0.0060029481537640095,
      "pose_mae_dtheta": 0.29325661063194275,
      "pose_mae_dx": 0.14142164587974548,
      "pose_mae_dy": 0.08955816924571991,
      "pose_rmse_dtheta": 0.4908239543437958,
      "pose_rmse_dx": 0.290692001581192,
      "pose_rmse_dy": 0.19606748223304749,
      "pose_rmse_mean": 0.3258611559867859,
      "rmse_dtheta": 0.05397563800215721,
      "rmse_dx": 0.03142276033759117,
      "rmse_dy": 0.010782171972095966,
      "rmse_mean": 0.03206019103527069,
      "rotation_flip": 0.007312614470720291,
      "sparse_tokens": 20231.0,
      "step": 1458,
      "turn_loss": 0.31004899740219116,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06778479836461625,
      "grad_norm": 0.4949699342250824,
      "learning_rate": 9.690269846692882e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.011401250958442688,
      "mae_dx": 0.0020200214348733425,
      "mae_dy": 0.0032304427586495876,
      "pose_mae_dtheta": 0.07709115743637085,
      "pose_mae_dx": 0.0215138029307127,
      "pose_mae_dy": 0.03685016185045242,
      "pose_rmse_dtheta": 0.20411206781864166,
      "pose_rmse_dx": 0.058206453919410706,
      "pose_rmse_dy": 0.12849007546901703,
      "pose_rmse_mean": 0.13026952743530273,
      "rmse_dtheta": 0.026085972785949707,
      "rmse_dx": 0.0063249338418245316,
      "rmse_dy": 0.009399308823049068,
      "rmse_mean": 0.013936738483607769,
      "rotation_flip": 0.006155303213745356,
      "sparse_tokens": 32073.0,
      "step": 1459,
      "turn_loss": 0.12384114414453506,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.06783125813045902,
      "grad_norm": 1.0382112264633179,
      "learning_rate": 9.689811548081823e-06,
      "loss": 0.219,
      "mae_dtheta": 0.0338396318256855,
      "mae_dx": 0.009009361267089844,
      "mae_dy": 0.006182283163070679,
      "pose_mae_dtheta": 0.27552828192710876,
      "pose_mae_dx": 0.09603865444660187,
      "pose_mae_dy": 0.06589875370264053,
      "pose_rmse_dtheta": 0.48878633975982666,
      "pose_rmse_dx": 0.1837509274482727,
      "pose_rmse_dy": 0.15513591468334198,
      "pose_rmse_mean": 0.2758910655975342,
      "rmse_dtheta": 0.051265209913253784,
      "rmse_dx": 0.018417060375213623,
      "rmse_dy": 0.010755336843430996,
      "rmse_mean": 0.026812536641955376,
      "rotation_flip": 0.008025682531297207,
      "sparse_tokens": 10460.0,
      "step": 1460,
      "turn_loss": 0.3217587172985077,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.0678777178963018,
      "grad_norm": 0.5616526007652283,
      "learning_rate": 9.689352921509725e-06,
      "loss": 0.1227,
      "mae_dtheta": 0.01170365884900093,
      "mae_dx": 0.002671723021194339,
      "mae_dy": 0.002654532203450799,
      "pose_mae_dtheta": 0.08856728672981262,
      "pose_mae_dx": 0.035753875970840454,
      "pose_mae_dy": 0.03046109527349472,
      "pose_rmse_dtheta": 0.24284730851650238,
      "pose_rmse_dx": 0.09871850907802582,
      "pose_rmse_dy": 0.09350444376468658,
      "pose_rmse_mean": 0.1450234353542328,
      "rmse_dtheta": 0.028354158625006676,
      "rmse_dx": 0.007335294038057327,
      "rmse_dy": 0.0072367144748568535,
      "rmse_mean": 0.01430872268974781,
      "rotation_flip": 0.006353861186653376,
      "sparse_tokens": 32137.0,
      "step": 1461,
      "turn_loss": 0.0887826606631279,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.06792417766214458,
      "grad_norm": 0.43393218517303467,
      "learning_rate": 9.688893967008661e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.010894645005464554,
      "mae_dx": 0.002165538724511862,
      "mae_dy": 0.002185075543820858,
      "pose_mae_dtheta": 0.07784278690814972,
      "pose_mae_dx": 0.023940490558743477,
      "pose_mae_dy": 0.027603957802057266,
      "pose_rmse_dtheta": 0.2044389247894287,
      "pose_rmse_dx": 0.0655989721417427,
      "pose_rmse_dy": 0.07406830787658691,
      "pose_rmse_mean": 0.11470206826925278,
      "rmse_dtheta": 0.026604244485497475,
      "rmse_dx": 0.006680698599666357,
      "rmse_dy": 0.005428890697658062,
      "rmse_mean": 0.012904612347483635,
      "rotation_flip": 0.004073319956660271,
      "sparse_tokens": 32153.0,
      "step": 1462,
      "turn_loss": 0.08588021993637085,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.06797063742798737,
      "grad_norm": 0.7915395498275757,
      "learning_rate": 9.688434684610725e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.02958603948354721,
      "mae_dx": 0.009532655589282513,
      "mae_dy": 0.0037220169324427843,
      "pose_mae_dtheta": 0.23511247336864471,
      "pose_mae_dx": 0.06378403306007385,
      "pose_mae_dy": 0.04406018927693367,
      "pose_rmse_dtheta": 0.4336170554161072,
      "pose_rmse_dx": 0.12613266706466675,
      "pose_rmse_dy": 0.1113048568367958,
      "pose_rmse_mean": 0.2236848771572113,
      "rmse_dtheta": 0.045065730810165405,
      "rmse_dx": 0.019106224179267883,
      "rmse_dy": 0.007304096128791571,
      "rmse_mean": 0.023825351148843765,
      "rotation_flip": 0.022727273404598236,
      "sparse_tokens": 7474.0,
      "step": 1463,
      "turn_loss": 0.30662745237350464,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.06801709719383014,
      "grad_norm": 0.4377468526363373,
      "learning_rate": 9.687975074348035e-06,
      "loss": 0.1088,
      "mae_dtheta": 0.01641843095421791,
      "mae_dx": 0.0034252735786139965,
      "mae_dy": 0.0054029137827456,
      "pose_mae_dtheta": 0.11933787912130356,
      "pose_mae_dx": 0.04932243004441261,
      "pose_mae_dy": 0.052634336054325104,
      "pose_rmse_dtheta": 0.25751665234565735,
      "pose_rmse_dx": 0.12315231561660767,
      "pose_rmse_dy": 0.11404503136873245,
      "pose_rmse_mean": 0.1649046689271927,
      "rmse_dtheta": 0.029705481603741646,
      "rmse_dx": 0.0089322030544281,
      "rmse_dy": 0.011008272878825665,
      "rmse_mean": 0.016548652201890945,
      "rotation_flip": 0.0048882681876420975,
      "sparse_tokens": 32089.0,
      "step": 1464,
      "turn_loss": 0.1519743949174881,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.06806355695967292,
      "grad_norm": 0.516714334487915,
      "learning_rate": 9.687515136252732e-06,
      "loss": 0.1319,
      "mae_dtheta": 0.00559176504611969,
      "mae_dx": 0.0011027994332835078,
      "mae_dy": 0.001277912873774767,
      "pose_mae_dtheta": 0.035978060215711594,
      "pose_mae_dx": 0.011429380625486374,
      "pose_mae_dy": 0.019333453848958015,
      "pose_rmse_dtheta": 0.08965431898832321,
      "pose_rmse_dx": 0.03863226994872093,
      "pose_rmse_dy": 0.05260513722896576,
      "pose_rmse_mean": 0.06029724329710007,
      "rmse_dtheta": 0.014162152074277401,
      "rmse_dx": 0.00416537607088685,
      "rmse_dy": 0.0030125663615763187,
      "rmse_mean": 0.007113364990800619,
      "rotation_flip": 0.0021770682651549578,
      "sparse_tokens": 32025.0,
      "step": 1465,
      "turn_loss": 0.05224639177322388,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2632.0,
      "epoch": 0.0681100167255157,
      "grad_norm": 0.6125362515449524,
      "learning_rate": 9.68705487035698e-06,
      "loss": 0.131,
      "mae_dtheta": 0.03978714346885681,
      "mae_dx": 0.004261265508830547,
      "mae_dy": 0.0014509231550619006,
      "pose_mae_dtheta": 0.3373933434486389,
      "pose_mae_dx": 0.017617469653487206,
      "pose_mae_dy": 0.017897306010127068,
      "pose_rmse_dtheta": 0.6193650364875793,
      "pose_rmse_dx": 0.0583513043820858,
      "pose_rmse_dy": 0.039417825639247894,
      "pose_rmse_mean": 0.23904471099376678,
      "rmse_dtheta": 0.0614202655851841,
      "rmse_dx": 0.01173917856067419,
      "rmse_dy": 0.0028964995872229338,
      "rmse_mean": 0.025351982563734055,
      "rotation_flip": 0.0,
      "sparse_tokens": 2233.0,
      "step": 1466,
      "turn_loss": 0.18873944878578186,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.06815647649135849,
      "grad_norm": 0.6579328775405884,
      "learning_rate": 9.686594276692965e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.012435431592166424,
      "mae_dx": 0.0014611699152737856,
      "mae_dy": 0.0028040308970957994,
      "pose_mae_dtheta": 0.08049479871988297,
      "pose_mae_dx": 0.02336130663752556,
      "pose_mae_dy": 0.037991445511579514,
      "pose_rmse_dtheta": 0.17482611536979675,
      "pose_rmse_dx": 0.05551176518201828,
      "pose_rmse_dy": 0.07957275956869125,
      "pose_rmse_mean": 0.10330355167388916,
      "rmse_dtheta": 0.02363484539091587,
      "rmse_dx": 0.004249914549291134,
      "rmse_dy": 0.005458097439259291,
      "rmse_mean": 0.011114286258816719,
      "rotation_flip": 0.004398826975375414,
      "sparse_tokens": 32089.0,
      "step": 1467,
      "turn_loss": 0.09477193653583527,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.06820293625720127,
      "grad_norm": 0.33269503712654114,
      "learning_rate": 9.686133355292895e-06,
      "loss": 0.09,
      "mae_dtheta": 0.024222323670983315,
      "mae_dx": 0.004319808445870876,
      "mae_dy": 0.0028504685033112764,
      "pose_mae_dtheta": 0.16381779313087463,
      "pose_mae_dx": 0.03836585208773613,
      "pose_mae_dy": 0.03452872857451439,
      "pose_rmse_dtheta": 0.35991305112838745,
      "pose_rmse_dx": 0.10351055860519409,
      "pose_rmse_dy": 0.0915556252002716,
      "pose_rmse_mean": 0.18499307334423065,
      "rmse_dtheta": 0.04199201986193657,
      "rmse_dx": 0.011741424910724163,
      "rmse_dy": 0.005993559956550598,
      "rmse_mean": 0.019909001886844635,
      "rotation_flip": 0.014953271485865116,
      "sparse_tokens": 10955.0,
      "step": 1468,
      "turn_loss": 0.18635399639606476,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.06824939602304404,
      "grad_norm": 0.4440560042858124,
      "learning_rate": 9.685672106189007e-06,
      "loss": 0.097,
      "mae_dtheta": 0.014092989265918732,
      "mae_dx": 0.002412947127595544,
      "mae_dy": 0.004265260882675648,
      "pose_mae_dtheta": 0.0999654158949852,
      "pose_mae_dx": 0.028712548315525055,
      "pose_mae_dy": 0.041428323835134506,
      "pose_rmse_dtheta": 0.23225237429141998,
      "pose_rmse_dx": 0.06931977719068527,
      "pose_rmse_dy": 0.09079758822917938,
      "pose_rmse_mean": 0.13078992068767548,
      "rmse_dtheta": 0.027978811413049698,
      "rmse_dx": 0.006890229880809784,
      "rmse_dy": 0.009334342554211617,
      "rmse_mean": 0.014734461903572083,
      "rotation_flip": 0.006645680405199528,
      "sparse_tokens": 32089.0,
      "step": 1469,
      "turn_loss": 0.13106918334960938,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29754.0,
      "epoch": 0.06829585578888682,
      "grad_norm": 0.4870460033416748,
      "learning_rate": 9.685210529413552e-06,
      "loss": 0.1349,
      "mae_dtheta": 0.03425707668066025,
      "mae_dx": 0.015416496433317661,
      "mae_dy": 0.006701358128339052,
      "pose_mae_dtheta": 0.271504670381546,
      "pose_mae_dx": 0.12650951743125916,
      "pose_mae_dy": 0.09330076724290848,
      "pose_rmse_dtheta": 0.45652079582214355,
      "pose_rmse_dx": 0.27380552887916565,
      "pose_rmse_dy": 0.19642210006713867,
      "pose_rmse_mean": 0.3089161515235901,
      "rmse_dtheta": 0.05140889808535576,
      "rmse_dx": 0.02957265079021454,
      "rmse_dy": 0.01261843554675579,
      "rmse_mean": 0.031199997290968895,
      "rotation_flip": 0.011627906933426857,
      "sparse_tokens": 25030.0,
      "step": 1470,
      "turn_loss": 0.3179350793361664,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.06834231555472961,
      "grad_norm": 0.7336565256118774,
      "learning_rate": 9.68474862499881e-06,
      "loss": 0.1871,
      "mae_dtheta": 0.011926437728106976,
      "mae_dx": 0.0022527738474309444,
      "mae_dy": 0.0019326690817251801,
      "pose_mae_dtheta": 0.08525162190198898,
      "pose_mae_dx": 0.024952856823801994,
      "pose_mae_dy": 0.02722051925957203,
      "pose_rmse_dtheta": 0.2354065477848053,
      "pose_rmse_dx": 0.0684671625494957,
      "pose_rmse_dy": 0.06806550174951553,
      "pose_rmse_mean": 0.12397973984479904,
      "rmse_dtheta": 0.026988761499524117,
      "rmse_dx": 0.0074106729589402676,
      "rmse_dy": 0.004101715050637722,
      "rmse_mean": 0.012833717279136181,
      "rotation_flip": 0.0027611597906798124,
      "sparse_tokens": 32089.0,
      "step": 1471,
      "turn_loss": 0.07871290296316147,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.06838877532057239,
      "grad_norm": 0.8127305507659912,
      "learning_rate": 9.684286392977082e-06,
      "loss": 0.2818,
      "mae_dtheta": 0.03331318497657776,
      "mae_dx": 0.011708122678101063,
      "mae_dy": 0.005900163669139147,
      "pose_mae_dtheta": 0.2521324157714844,
      "pose_mae_dx": 0.11666807532310486,
      "pose_mae_dy": 0.09288725256919861,
      "pose_rmse_dtheta": 0.43144187331199646,
      "pose_rmse_dx": 0.27562588453292847,
      "pose_rmse_dy": 0.21297869086265564,
      "pose_rmse_mean": 0.30668216943740845,
      "rmse_dtheta": 0.04833601042628288,
      "rmse_dx": 0.02574237808585167,
      "rmse_dy": 0.010994808748364449,
      "rmse_mean": 0.02835773304104805,
      "rotation_flip": 0.017175571992993355,
      "sparse_tokens": 11485.0,
      "step": 1472,
      "turn_loss": 0.2863364815711975,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.06843523508641516,
      "grad_norm": 0.4493524730205536,
      "learning_rate": 9.683823833380692e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.044031668454408646,
      "mae_dx": 0.011997902765870094,
      "mae_dy": 0.006716666743159294,
      "pose_mae_dtheta": 0.38466620445251465,
      "pose_mae_dx": 0.07482970505952835,
      "pose_mae_dy": 0.04849044233560562,
      "pose_rmse_dtheta": 0.6075004935264587,
      "pose_rmse_dx": 0.16181312501430511,
      "pose_rmse_dy": 0.1260281652212143,
      "pose_rmse_mean": 0.29844728112220764,
      "rmse_dtheta": 0.062246840447187424,
      "rmse_dx": 0.023084118962287903,
      "rmse_dy": 0.014279237017035484,
      "rmse_mean": 0.033203400671482086,
      "rotation_flip": 0.014705882407724857,
      "sparse_tokens": 11975.0,
      "step": 1473,
      "turn_loss": 0.3732709586620331,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.06848169485225794,
      "grad_norm": 0.5960851907730103,
      "learning_rate": 9.683360946241988e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.009602026082575321,
      "mae_dx": 0.002105437684804201,
      "mae_dy": 0.00034239370143041015,
      "pose_mae_dtheta": 0.07322400063276291,
      "pose_mae_dx": 0.01771528646349907,
      "pose_mae_dy": 0.005457374267280102,
      "pose_rmse_dtheta": 0.28341639041900635,
      "pose_rmse_dx": 0.04668845981359482,
      "pose_rmse_dy": 0.009874765761196613,
      "pose_rmse_mean": 0.1133265420794487,
      "rmse_dtheta": 0.031778860837221146,
      "rmse_dx": 0.006254183128476143,
      "rmse_dy": 0.0006104588392190635,
      "rmse_mean": 0.012881169095635414,
      "rotation_flip": 0.002466091187670827,
      "sparse_tokens": 32201.0,
      "step": 1474,
      "turn_loss": 0.049957264214754105,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.06852815461810073,
      "grad_norm": 1.2514257431030273,
      "learning_rate": 9.682897731593341e-06,
      "loss": 0.2846,
      "mae_dtheta": 0.03671660274267197,
      "mae_dx": 0.012398537248373032,
      "mae_dy": 0.00570105854421854,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999992251396179,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.58734130859375,
      "model/head/act_norm_mean": 106.46837158203125,
      "model/head/act_norm_min": 68.91333770751953,
      "model/head/act_over_embed": 73.16606172377104,
      "model/head/grad_frac": 0.10320056974887848,
      "model/head/grad_norm": 0.10320048779249191,
      "model/head/grad_zero_frac": 0.00020210212096571922,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.686328125,
      "model/head/update_ratio": 0.0017951874760910869,
      "model/head/weight_delta": 4.3243560791015625,
      "model/head/weight_delta_rel": 0.07586201280355453,
      "model/head/weight_norm": 57.4873046875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41277486085891724,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41270665424626046,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4126545488834381,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2836158766186027,
      "model/modality_embedder.encoders.pose/grad_frac": 0.03442111983895302,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03442109376192093,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5352991615853658,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011204303009435534,
      "model/modality_embedder.encoders.pose/weight_delta": 1.3895397186279297,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.04540059342980385,
      "model/modality_embedder.encoders.pose/weight_norm": 30.721315383911133,
      "model/modality_embedder/grad_frac": 0.03442111983895302,
      "model/modality_embedder/grad_norm": 0.03442109376192093,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5352991615853658,
      "model/modality_embedder/update_ratio": 0.0011204303009435534,
      "model/modality_embedder/weight_delta": 1.3895397186279297,
      "model/modality_embedder/weight_delta_rel": 0.04540059342980385,
      "model/modality_embedder/weight_norm": 30.721315383911133,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.21208190917969,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.963380456349206,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.047944068908691,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.780650036158175,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11261394619941711,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.11261385679244995,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.004086129833012819,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.7825939059257507,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.02851819433271885,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.560028076171875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.7662124633789,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.86063523065476,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.535608291625977,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.397251917292497,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09956303238868713,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.09956295788288116,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0034231478348374367,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.9652338027954102,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.033436454832553864,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.085205078125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.41766357421875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.512562003968252,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.724024772644043,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.532471461495646,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08748284727334976,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.08748278021812439,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0029147970490157604,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.0197725296020508,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.03424205258488655,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.013334274291992,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.88092041015625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.473025173611113,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.728720664978027,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.879720105819587,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07086624205112457,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0708661898970604,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0024078874848783016,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.8703411817550659,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.029744131490588188,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.430856704711914,
      "model/normalizer/grad_frac": 0.3213147222995758,
      "model/normalizer/grad_norm": 0.3213144838809967,
      "model/normalizer/grad_zero_frac": 0.00019144162070006132,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004125388339161873,
      "model/normalizer/weight_delta": 1.8729279041290283,
      "model/normalizer/weight_delta_rel": 0.024122226983308792,
      "model/normalizer/weight_norm": 77.8870849609375,
      "pose_mae_dtheta": 0.2936137616634369,
      "pose_mae_dx": 0.08869878202676773,
      "pose_mae_dy": 0.09378369152545929,
      "pose_rmse_dtheta": 0.5217353701591492,
      "pose_rmse_dx": 0.18183332681655884,
      "pose_rmse_dy": 0.17933551967144012,
      "pose_rmse_mean": 0.29430142045021057,
      "rmse_dtheta": 0.0551442913711071,
      "rmse_dx": 0.024555575102567673,
      "rmse_dy": 0.009945915080606937,
      "rmse_mean": 0.029881928116083145,
      "rotation_flip": 0.0225694440305233,
      "sparse_tokens": 9929.0,
      "step": 1475,
      "turn_loss": 0.28010043501853943,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.06857461438394351,
      "grad_norm": 0.4530864953994751,
      "learning_rate": 9.68243418946714e-06,
      "loss": 0.1615,
      "mae_dtheta": 0.05111687257885933,
      "mae_dx": 0.016069529578089714,
      "mae_dy": 0.005696890875697136,
      "pose_mae_dtheta": 0.4235698878765106,
      "pose_mae_dx": 0.12591896951198578,
      "pose_mae_dy": 0.07134406268596649,
      "pose_rmse_dtheta": 0.6447398662567139,
      "pose_rmse_dx": 0.24147780239582062,
      "pose_rmse_dy": 0.18760639429092407,
      "pose_rmse_mean": 0.3579413592815399,
      "rmse_dtheta": 0.06814492493867874,
      "rmse_dx": 0.027379753068089485,
      "rmse_dy": 0.013013782911002636,
      "rmse_mean": 0.03617948666214943,
      "rotation_flip": 0.013569937087595463,
      "sparse_tokens": 14481.0,
      "step": 1476,
      "turn_loss": 0.37202441692352295,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06862107414978628,
      "grad_norm": 0.5867893695831299,
      "learning_rate": 9.681970319895804e-06,
      "loss": 0.1674,
      "mae_dtheta": 0.013040420599281788,
      "mae_dx": 0.0022639762610197067,
      "mae_dy": 0.002081139013171196,
      "pose_mae_dtheta": 0.09013848006725311,
      "pose_mae_dx": 0.028473442420363426,
      "pose_mae_dy": 0.030427757650613785,
      "pose_rmse_dtheta": 0.22100897133350372,
      "pose_rmse_dx": 0.07123827934265137,
      "pose_rmse_dy": 0.07198651134967804,
      "pose_rmse_mean": 0.12141124904155731,
      "rmse_dtheta": 0.027851879596710205,
      "rmse_dx": 0.006985317915678024,
      "rmse_dy": 0.00408628536388278,
      "rmse_mean": 0.012974495068192482,
      "rotation_flip": 0.0027678925544023514,
      "sparse_tokens": 32105.0,
      "step": 1477,
      "turn_loss": 0.09662874788045883,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.06866753391562906,
      "grad_norm": 0.6386833786964417,
      "learning_rate": 9.68150612291177e-06,
      "loss": 0.2936,
      "mae_dtheta": 0.03856741636991501,
      "mae_dx": 0.014134193770587444,
      "mae_dy": 0.007696059532463551,
      "pose_mae_dtheta": 0.32840847969055176,
      "pose_mae_dx": 0.12538138031959534,
      "pose_mae_dy": 0.09151150286197662,
      "pose_rmse_dtheta": 0.5148522853851318,
      "pose_rmse_dx": 0.2799394726753235,
      "pose_rmse_dy": 0.21431343257427216,
      "pose_rmse_mean": 0.3363684117794037,
      "rmse_dtheta": 0.052155472338199615,
      "rmse_dx": 0.02700185403227806,
      "rmse_dy": 0.01582678221166134,
      "rmse_mean": 0.031661368906497955,
      "rotation_flip": 0.013348164968192577,
      "sparse_tokens": 15497.0,
      "step": 1478,
      "turn_loss": 0.3383893072605133,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.06871399368147185,
      "grad_norm": 0.665105938911438,
      "learning_rate": 9.6810415985475e-06,
      "loss": 0.1947,
      "mae_dtheta": 0.026897916570305824,
      "mae_dx": 0.009454497136175632,
      "mae_dy": 0.006424419116228819,
      "pose_mae_dtheta": 0.21562746167182922,
      "pose_mae_dx": 0.09159132838249207,
      "pose_mae_dy": 0.0855262503027916,
      "pose_rmse_dtheta": 0.41328540444374084,
      "pose_rmse_dx": 0.2246454954147339,
      "pose_rmse_dy": 0.18673738837242126,
      "pose_rmse_mean": 0.27488943934440613,
      "rmse_dtheta": 0.04451557993888855,
      "rmse_dx": 0.022484425455331802,
      "rmse_dy": 0.011658212170004845,
      "rmse_mean": 0.026219405233860016,
      "rotation_flip": 0.009487666189670563,
      "sparse_tokens": 11993.0,
      "step": 1479,
      "turn_loss": 0.2823902368545532,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.06876045344731463,
      "grad_norm": 0.4991549551486969,
      "learning_rate": 9.68057674683548e-06,
      "loss": 0.1053,
      "mae_dtheta": 0.03726781904697418,
      "mae_dx": 0.01073148287832737,
      "mae_dy": 0.004722147714346647,
      "pose_mae_dtheta": 0.2971361577510834,
      "pose_mae_dx": 0.07109592109918594,
      "pose_mae_dy": 0.056617893278598785,
      "pose_rmse_dtheta": 0.6173717975616455,
      "pose_rmse_dx": 0.14681679010391235,
      "pose_rmse_dy": 0.10632575303316116,
      "pose_rmse_mean": 0.29017144441604614,
      "rmse_dtheta": 0.060886200517416,
      "rmse_dx": 0.02061285637319088,
      "rmse_dy": 0.009179598651826382,
      "rmse_mean": 0.030226219445466995,
      "rotation_flip": 0.004098360426723957,
      "sparse_tokens": 4202.0,
      "step": 1480,
      "turn_loss": 0.20116715133190155,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.0688069132131574,
      "grad_norm": 0.787542462348938,
      "learning_rate": 9.680111567808212e-06,
      "loss": 0.2083,
      "mae_dtheta": 0.04538794234395027,
      "mae_dx": 0.01724376156926155,
      "mae_dy": 0.006310855504125357,
      "pose_mae_dtheta": 0.3890550136566162,
      "pose_mae_dx": 0.13811849057674408,
      "pose_mae_dy": 0.1037258729338646,
      "pose_rmse_dtheta": 0.6143355965614319,
      "pose_rmse_dx": 0.2777312994003296,
      "pose_rmse_dy": 0.22343401610851288,
      "pose_rmse_mean": 0.3718336522579193,
      "rmse_dtheta": 0.06260579824447632,
      "rmse_dx": 0.030894014984369278,
      "rmse_dy": 0.011486989445984364,
      "rmse_mean": 0.03499560058116913,
      "rotation_flip": 0.00937500037252903,
      "sparse_tokens": 21338.0,
      "step": 1481,
      "turn_loss": 0.34962862730026245,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 18773.0,
      "epoch": 0.06885337297900018,
      "grad_norm": 1.3058868646621704,
      "learning_rate": 9.679646061498233e-06,
      "loss": 0.2563,
      "mae_dtheta": 0.037593964487314224,
      "mae_dx": 0.015620867721736431,
      "mae_dy": 0.005453747697174549,
      "pose_mae_dtheta": 0.3200439512729645,
      "pose_mae_dx": 0.1244809627532959,
      "pose_mae_dy": 0.08467129617929459,
      "pose_rmse_dtheta": 0.5397736430168152,
      "pose_rmse_dx": 0.2683831751346588,
      "pose_rmse_dy": 0.1876104325056076,
      "pose_rmse_mean": 0.3319224417209625,
      "rmse_dtheta": 0.054883118718862534,
      "rmse_dx": 0.029348978772759438,
      "rmse_dy": 0.009282954037189484,
      "rmse_mean": 0.031171685084700584,
      "rotation_flip": 0.011013215407729149,
      "sparse_tokens": 14523.0,
      "step": 1482,
      "turn_loss": 0.3081691563129425,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06889983274484296,
      "grad_norm": 0.5020955801010132,
      "learning_rate": 9.679180227938095e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.014207033440470695,
      "mae_dx": 0.0031389202922582626,
      "mae_dy": 0.0035930583253502846,
      "pose_mae_dtheta": 0.10200727730989456,
      "pose_mae_dx": 0.038735732436180115,
      "pose_mae_dy": 0.035996560007333755,
      "pose_rmse_dtheta": 0.2421892285346985,
      "pose_rmse_dx": 0.10433830320835114,
      "pose_rmse_dy": 0.08756932616233826,
      "pose_rmse_mean": 0.14469894766807556,
      "rmse_dtheta": 0.029185187071561813,
      "rmse_dx": 0.008401697501540184,
      "rmse_dy": 0.008821485564112663,
      "rmse_mean": 0.015469457022845745,
      "rotation_flip": 0.0023210830986499786,
      "sparse_tokens": 32105.0,
      "step": 1483,
      "turn_loss": 0.11426243931055069,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.06894629251068575,
      "grad_norm": 0.5347409844398499,
      "learning_rate": 9.67871406716037e-06,
      "loss": 0.1633,
      "mae_dtheta": 0.03555380180478096,
      "mae_dx": 0.012161269783973694,
      "mae_dy": 0.006380429025739431,
      "pose_mae_dtheta": 0.2635840177536011,
      "pose_mae_dx": 0.09321071207523346,
      "pose_mae_dy": 0.06992492824792862,
      "pose_rmse_dtheta": 0.47431886196136475,
      "pose_rmse_dx": 0.21554827690124512,
      "pose_rmse_dy": 0.1457727551460266,
      "pose_rmse_mean": 0.27854663133621216,
      "rmse_dtheta": 0.05476143956184387,
      "rmse_dx": 0.02445201762020588,
      "rmse_dy": 0.011929149739444256,
      "rmse_mean": 0.030380867421627045,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 22217.0,
      "step": 1484,
      "turn_loss": 0.3106899857521057,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.06899275227652853,
      "grad_norm": 0.40655696392059326,
      "learning_rate": 9.678247579197658e-06,
      "loss": 0.1244,
      "mae_dtheta": 0.00762011157348752,
      "mae_dx": 0.0020009560976177454,
      "mae_dy": 0.0018323620315641165,
      "pose_mae_dtheta": 0.05372385308146477,
      "pose_mae_dx": 0.01977485604584217,
      "pose_mae_dy": 0.018127301707863808,
      "pose_rmse_dtheta": 0.12393558025360107,
      "pose_rmse_dx": 0.04964691400527954,
      "pose_rmse_dy": 0.046437378972768784,
      "pose_rmse_mean": 0.07333996146917343,
      "rmse_dtheta": 0.01817726343870163,
      "rmse_dx": 0.00623451778665185,
      "rmse_dy": 0.005520075559616089,
      "rmse_mean": 0.009977285750210285,
      "rotation_flip": 0.006402560975402594,
      "sparse_tokens": 32169.0,
      "step": 1485,
      "turn_loss": 0.06825616955757141,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6178.0,
      "epoch": 0.0690392120423713,
      "grad_norm": 0.7347478866577148,
      "learning_rate": 9.677780764082583e-06,
      "loss": 0.1922,
      "mae_dtheta": 0.059284672141075134,
      "mae_dx": 0.012323624454438686,
      "mae_dy": 0.007347533479332924,
      "pose_mae_dtheta": 0.5046969056129456,
      "pose_mae_dx": 0.07874438911676407,
      "pose_mae_dy": 0.07347854971885681,
      "pose_rmse_dtheta": 0.7286649942398071,
      "pose_rmse_dx": 0.19054695963859558,
      "pose_rmse_dy": 0.17157232761383057,
      "pose_rmse_mean": 0.36359477043151855,
      "rmse_dtheta": 0.07200976461172104,
      "rmse_dx": 0.025940578430891037,
      "rmse_dy": 0.01487758755683899,
      "rmse_mean": 0.03760930895805359,
      "rotation_flip": 0.009999999776482582,
      "sparse_tokens": 4597.0,
      "step": 1486,
      "turn_loss": 0.5303801894187927,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.06908567180821408,
      "grad_norm": 0.8007665276527405,
      "learning_rate": 9.677313621847788e-06,
      "loss": 0.1869,
      "mae_dtheta": 0.05079660192131996,
      "mae_dx": 0.011935115791857243,
      "mae_dy": 0.00444613816216588,
      "pose_mae_dtheta": 0.37409815192222595,
      "pose_mae_dx": 0.09198252111673355,
      "pose_mae_dy": 0.05231769382953644,
      "pose_rmse_dtheta": 0.6104658246040344,
      "pose_rmse_dx": 0.21324265003204346,
      "pose_rmse_dy": 0.1444268375635147,
      "pose_rmse_mean": 0.3227117657661438,
      "rmse_dtheta": 0.07219670712947845,
      "rmse_dx": 0.024188028648495674,
      "rmse_dy": 0.01089139748364687,
      "rmse_mean": 0.03575871139764786,
      "rotation_flip": 0.019434629008173943,
      "sparse_tokens": 9922.0,
      "step": 1487,
      "turn_loss": 0.27750664949417114,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.06913213157405687,
      "grad_norm": 0.5928601622581482,
      "learning_rate": 9.676846152525942e-06,
      "loss": 0.1482,
      "mae_dtheta": 0.033877842128276825,
      "mae_dx": 0.005834758281707764,
      "mae_dy": 0.005004288163036108,
      "pose_mae_dtheta": 0.26235514879226685,
      "pose_mae_dx": 0.050711460411548615,
      "pose_mae_dy": 0.05225452408194542,
      "pose_rmse_dtheta": 0.4703889787197113,
      "pose_rmse_dx": 0.1042879968881607,
      "pose_rmse_dy": 0.14288151264190674,
      "pose_rmse_mean": 0.23918616771697998,
      "rmse_dtheta": 0.05319226160645485,
      "rmse_dx": 0.012473574839532375,
      "rmse_dy": 0.01292460598051548,
      "rmse_mean": 0.026196813210844994,
      "rotation_flip": 0.009999999776482582,
      "sparse_tokens": 6592.0,
      "step": 1488,
      "turn_loss": 0.2661246061325073,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06917859133989965,
      "grad_norm": 0.6258735060691833,
      "learning_rate": 9.676378356149733e-06,
      "loss": 0.1505,
      "mae_dtheta": 0.010102663189172745,
      "mae_dx": 0.0016465297667309642,
      "mae_dy": 0.003242457052692771,
      "pose_mae_dtheta": 0.0720130205154419,
      "pose_mae_dx": 0.027255002409219742,
      "pose_mae_dy": 0.037717681378126144,
      "pose_rmse_dtheta": 0.1881105750799179,
      "pose_rmse_dx": 0.07251022011041641,
      "pose_rmse_dy": 0.11246032267808914,
      "pose_rmse_mean": 0.12436037510633469,
      "rmse_dtheta": 0.022879693657159805,
      "rmse_dx": 0.004299264866858721,
      "rmse_dy": 0.009394519031047821,
      "rmse_mean": 0.012191159650683403,
      "rotation_flip": 0.006968641187995672,
      "sparse_tokens": 32073.0,
      "step": 1489,
      "turn_loss": 0.08474457263946533,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.06922505110574242,
      "grad_norm": 0.48100408911705017,
      "learning_rate": 9.675910232751878e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.03611426800489426,
      "mae_dx": 0.013450606726109982,
      "mae_dy": 0.004804678726941347,
      "pose_mae_dtheta": 0.28286948800086975,
      "pose_mae_dx": 0.10521747171878815,
      "pose_mae_dy": 0.048850905150175095,
      "pose_rmse_dtheta": 0.4944097101688385,
      "pose_rmse_dx": 0.24191801249980927,
      "pose_rmse_dy": 0.13230670988559723,
      "pose_rmse_mean": 0.28954482078552246,
      "rmse_dtheta": 0.0537898987531662,
      "rmse_dx": 0.026329347863793373,
      "rmse_dy": 0.010330284014344215,
      "rmse_mean": 0.03014984354376793,
      "rotation_flip": 0.01291989628225565,
      "sparse_tokens": 21133.0,
      "step": 1490,
      "turn_loss": 0.3055996596813202,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.0692715108715852,
      "grad_norm": 0.6228084564208984,
      "learning_rate": 9.675441782365107e-06,
      "loss": 0.1241,
      "mae_dtheta": 0.029236027970910072,
      "mae_dx": 0.005305476952344179,
      "mae_dy": 0.006581021007150412,
      "pose_mae_dtheta": 0.21254503726959229,
      "pose_mae_dx": 0.05182182043790817,
      "pose_mae_dy": 0.09319362044334412,
      "pose_rmse_dtheta": 0.3470870554447174,
      "pose_rmse_dx": 0.12971626222133636,
      "pose_rmse_dy": 0.17892657220363617,
      "pose_rmse_mean": 0.21857663989067078,
      "rmse_dtheta": 0.04442319646477699,
      "rmse_dx": 0.014709604904055595,
      "rmse_dy": 0.01151700783520937,
      "rmse_mean": 0.023549936711788177,
      "rotation_flip": 0.021739130839705467,
      "sparse_tokens": 4813.0,
      "step": 1491,
      "turn_loss": 0.2550879120826721,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.06931797063742799,
      "grad_norm": 0.7547092437744141,
      "learning_rate": 9.674973005022186e-06,
      "loss": 0.1397,
      "mae_dtheta": 0.03604365512728691,
      "mae_dx": 0.010919814929366112,
      "mae_dy": 0.003943316172808409,
      "pose_mae_dtheta": 0.27090924978256226,
      "pose_mae_dx": 0.08699176460504532,
      "pose_mae_dy": 0.0421273298561573,
      "pose_rmse_dtheta": 0.47247323393821716,
      "pose_rmse_dx": 0.19395679235458374,
      "pose_rmse_dy": 0.09319763630628586,
      "pose_rmse_mean": 0.2532092332839966,
      "rmse_dtheta": 0.054177649319171906,
      "rmse_dx": 0.022562773898243904,
      "rmse_dy": 0.007835892960429192,
      "rmse_mean": 0.028192106634378433,
      "rotation_flip": 0.015107913874089718,
      "sparse_tokens": 21602.0,
      "step": 1492,
      "turn_loss": 0.26668766140937805,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.06936443040327077,
      "grad_norm": 0.5819094181060791,
      "learning_rate": 9.674503900755892e-06,
      "loss": 0.1622,
      "mae_dtheta": 0.013705122284591198,
      "mae_dx": 0.003153028432279825,
      "mae_dy": 0.002734895097091794,
      "pose_mae_dtheta": 0.09169282019138336,
      "pose_mae_dx": 0.03348644822835922,
      "pose_mae_dy": 0.032956067472696304,
      "pose_rmse_dtheta": 0.23492325842380524,
      "pose_rmse_dx": 0.08443583548069,
      "pose_rmse_dy": 0.07745817303657532,
      "pose_rmse_mean": 0.13227242231369019,
      "rmse_dtheta": 0.029425878077745438,
      "rmse_dx": 0.009385613724589348,
      "rmse_dy": 0.006567311938852072,
      "rmse_mean": 0.015126267448067665,
      "rotation_flip": 0.005636978428810835,
      "sparse_tokens": 32121.0,
      "step": 1493,
      "turn_loss": 0.11522433906793594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.06941089016911355,
      "grad_norm": 0.4899320602416992,
      "learning_rate": 9.674034469599032e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.011189080774784088,
      "mae_dx": 0.0017643431201577187,
      "mae_dy": 0.002192203886806965,
      "pose_mae_dtheta": 0.07933436334133148,
      "pose_mae_dx": 0.02471897378563881,
      "pose_mae_dy": 0.033250726759433746,
      "pose_rmse_dtheta": 0.17548523843288422,
      "pose_rmse_dx": 0.06549477577209473,
      "pose_rmse_dy": 0.07426825165748596,
      "pose_rmse_mean": 0.10508275032043457,
      "rmse_dtheta": 0.02211041934788227,
      "rmse_dx": 0.006127755623310804,
      "rmse_dy": 0.004318470600992441,
      "rmse_mean": 0.010852215811610222,
      "rotation_flip": 0.0011848341673612595,
      "sparse_tokens": 32073.0,
      "step": 1494,
      "turn_loss": 0.08685329556465149,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.06945734993495632,
      "grad_norm": 0.612968921661377,
      "learning_rate": 9.67356471158443e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.03408238664269447,
      "mae_dx": 0.009862213395535946,
      "mae_dy": 0.005920199677348137,
      "pose_mae_dtheta": 0.2821943163871765,
      "pose_mae_dx": 0.07204344123601913,
      "pose_mae_dy": 0.08393090218305588,
      "pose_rmse_dtheta": 0.44101133942604065,
      "pose_rmse_dx": 0.15539559721946716,
      "pose_rmse_dy": 0.1764543056488037,
      "pose_rmse_mean": 0.2576204240322113,
      "rmse_dtheta": 0.048334259539842606,
      "rmse_dx": 0.020780157297849655,
      "rmse_dy": 0.01031567808240652,
      "rmse_mean": 0.026476699858903885,
      "rotation_flip": 0.010903426446020603,
      "sparse_tokens": 11303.0,
      "step": 1495,
      "turn_loss": 0.2457808554172516,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.06950380970079911,
      "grad_norm": 0.5088985562324524,
      "learning_rate": 9.673094626744944e-06,
      "loss": 0.106,
      "mae_dtheta": 0.009926125407218933,
      "mae_dx": 0.0015729558654129505,
      "mae_dy": 0.0026533170603215694,
      "pose_mae_dtheta": 0.06835973262786865,
      "pose_mae_dx": 0.02719670720398426,
      "pose_mae_dy": 0.034261204302310944,
      "pose_rmse_dtheta": 0.1417270451784134,
      "pose_rmse_dx": 0.06220899522304535,
      "pose_rmse_dy": 0.0815640464425087,
      "pose_rmse_mean": 0.09516669809818268,
      "rmse_dtheta": 0.02013726532459259,
      "rmse_dx": 0.004326024558395147,
      "rmse_dy": 0.0053963023237884045,
      "rmse_mean": 0.00995319802314043,
      "rotation_flip": 0.0036173632834106684,
      "sparse_tokens": 32057.0,
      "step": 1496,
      "turn_loss": 0.08778183907270432,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.06955026946664189,
      "grad_norm": 0.5901263356208801,
      "learning_rate": 9.67262421511344e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.017395149916410446,
      "mae_dx": 0.005257484503090382,
      "mae_dy": 0.007062659133225679,
      "pose_mae_dtheta": 0.13138140738010406,
      "pose_mae_dx": 0.0660015419125557,
      "pose_mae_dy": 0.07539644092321396,
      "pose_rmse_dtheta": 0.27817490696907043,
      "pose_rmse_dx": 0.15122106671333313,
      "pose_rmse_dy": 0.1935790330171585,
      "pose_rmse_mean": 0.2076583355665207,
      "rmse_dtheta": 0.03187137469649315,
      "rmse_dx": 0.013140511699020863,
      "rmse_dy": 0.01618528738617897,
      "rmse_mean": 0.020399058237671852,
      "rotation_flip": 0.00837628822773695,
      "sparse_tokens": 32105.0,
      "step": 1497,
      "turn_loss": 0.19534994661808014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.06959672923248467,
      "grad_norm": 0.5596585273742676,
      "learning_rate": 9.672153476722816e-06,
      "loss": 0.1691,
      "mae_dtheta": 0.012079103849828243,
      "mae_dx": 0.0024719301145523787,
      "mae_dy": 0.002687609987333417,
      "pose_mae_dtheta": 0.08812692016363144,
      "pose_mae_dx": 0.032989371567964554,
      "pose_mae_dy": 0.03359666466712952,
      "pose_rmse_dtheta": 0.21188658475875854,
      "pose_rmse_dx": 0.07850003987550735,
      "pose_rmse_dy": 0.08341909199953079,
      "pose_rmse_mean": 0.12460190057754517,
      "rmse_dtheta": 0.025659171864390373,
      "rmse_dx": 0.006882325280457735,
      "rmse_dy": 0.006492700427770615,
      "rmse_mean": 0.013011399656534195,
      "rotation_flip": 0.003508772002533078,
      "sparse_tokens": 32121.0,
      "step": 1498,
      "turn_loss": 0.10553741455078125,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.06964318899832744,
      "grad_norm": 0.9641684889793396,
      "learning_rate": 9.671682411605991e-06,
      "loss": 0.1688,
      "mae_dtheta": 0.03166910260915756,
      "mae_dx": 0.011888326145708561,
      "mae_dy": 0.00919853150844574,
      "pose_mae_dtheta": 0.23462079465389252,
      "pose_mae_dx": 0.08365695923566818,
      "pose_mae_dy": 0.08243287354707718,
      "pose_rmse_dtheta": 0.3813636302947998,
      "pose_rmse_dx": 0.17816275358200073,
      "pose_rmse_dy": 0.1851697862148285,
      "pose_rmse_mean": 0.24823205173015594,
      "rmse_dtheta": 0.047252487391233444,
      "rmse_dx": 0.022696198895573616,
      "rmse_dy": 0.018052102997899055,
      "rmse_mean": 0.02933359704911709,
      "rotation_flip": 0.013050571084022522,
      "sparse_tokens": 10017.0,
      "step": 1499,
      "turn_loss": 0.34188610315322876,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 5530.0,
      "epoch": 0.06968964876417023,
      "grad_norm": 0.5367979407310486,
      "learning_rate": 9.67121101979591e-06,
      "loss": 0.118,
      "mae_dtheta": 0.03493375703692436,
      "mae_dx": 0.012886865064501762,
      "mae_dy": 0.006104191765189171,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5367978811264038,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 132.6723175048828,
      "model/head/act_norm_mean": 111.71921673943015,
      "model/head/act_norm_min": 78.11347961425781,
      "model/head/act_over_embed": 76.77449167512243,
      "model/head/grad_frac": 0.10285567492246628,
      "model/head/grad_norm": 0.05521271005272865,
      "model/head/grad_zero_frac": 0.00014594501408282667,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6806640625,
      "model/head/update_ratio": 0.0009602906065993011,
      "model/head/weight_delta": 4.369060039520264,
      "model/head/weight_delta_rel": 0.07664625346660614,
      "model/head/weight_norm": 57.49583435058594,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41281700134277344,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41281700134277344,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41281700134277344,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28369170817641226,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08615844696760178,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04624967277050018,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015053761890158057,
      "model/modality_embedder.encoders.pose/weight_delta": 1.4027830362319946,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.045833293348550797,
      "model/modality_embedder.encoders.pose/weight_norm": 30.722999572753906,
      "model/modality_embedder/grad_frac": 0.08615844696760178,
      "model/modality_embedder/grad_norm": 0.04624967277050018,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0015053761890158057,
      "model/modality_embedder/weight_delta": 1.4027830362319946,
      "model/modality_embedder/weight_delta_rel": 0.045833293348550797,
      "model/modality_embedder/weight_norm": 30.722999572753906,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.9825210571289,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.604002538515406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.179608345031738,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.220891528621216,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09281866997480392,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04982486367225647,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018076992128044367,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.7940057516098022,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.028934048488736153,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.562585830688477,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 77.49273681640625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.534362963935575,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.742874145507812,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.86024392314149,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08825881779193878,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.047377146780490875,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016286647878587246,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.9800370931625366,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.03394925221800804,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.089563369750977,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.39164733886719,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.21662180497199,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.294483184814453,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.016307948257122,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08191309124231339,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04397077485918999,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014648673823103309,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.0359114408493042,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.03478396683931351,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.01689910888672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.70620727539062,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.11756134745565,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.622955322265625,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.322651398728283,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08109482377767563,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04353152960538864,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014790486311540008,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.8830604553222656,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.030178815126419067,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.43211555480957,
      "model/normalizer/grad_frac": 0.31802305579185486,
      "model/normalizer/grad_norm": 0.1707140952348709,
      "model/normalizer/grad_zero_frac": 0.00017607901827432215,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021917156409472227,
      "model/normalizer/weight_delta": 1.9012212753295898,
      "model/normalizer/weight_delta_rel": 0.02448662929236889,
      "model/normalizer/weight_norm": 77.890625,
      "pose_mae_dtheta": 0.2877621352672577,
      "pose_mae_dx": 0.09758147597312927,
      "pose_mae_dy": 0.07336932420730591,
      "pose_rmse_dtheta": 0.5493468046188354,
      "pose_rmse_dx": 0.23168183863162994,
      "pose_rmse_dy": 0.16047745943069458,
      "pose_rmse_mean": 0.31383538246154785,
      "rmse_dtheta": 0.05286884680390358,
      "rmse_dx": 0.026134490966796875,
      "rmse_dy": 0.011242245323956013,
      "rmse_mean": 0.030081860721111298,
      "rotation_flip": 0.003508772002533078,
      "sparse_tokens": 4658.0,
      "step": 1500,
      "turn_loss": 0.2592529356479645,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.06973610853001301,
      "grad_norm": 0.7031251192092896,
      "learning_rate": 9.670739301325534e-06,
      "loss": 0.2886,
      "mae_dtheta": 0.01592288352549076,
      "mae_dx": 0.006090992130339146,
      "mae_dy": 0.002150061773136258,
      "pose_mae_dtheta": 0.13859200477600098,
      "pose_mae_dx": 0.053509559482336044,
      "pose_mae_dy": 0.025164121761918068,
      "pose_rmse_dtheta": 0.26545271277427673,
      "pose_rmse_dx": 0.12120257318019867,
      "pose_rmse_dy": 0.048757459968328476,
      "pose_rmse_mean": 0.14513757824897766,
      "rmse_dtheta": 0.028510503470897675,
      "rmse_dx": 0.01422908529639244,
      "rmse_dy": 0.0040282756090164185,
      "rmse_mean": 0.01558928843587637,
      "rotation_flip": 0.0033333334140479565,
      "sparse_tokens": 6073.0,
      "step": 1501,
      "turn_loss": 0.13355578482151031,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.06978256829585579,
      "grad_norm": 0.6294199824333191,
      "learning_rate": 9.670267256227852e-06,
      "loss": 0.0981,
      "mae_dtheta": 0.012774702161550522,
      "mae_dx": 0.002562328241765499,
      "mae_dy": 0.0033663208596408367,
      "pose_mae_dtheta": 0.09880147874355316,
      "pose_mae_dx": 0.032488346099853516,
      "pose_mae_dy": 0.0365905798971653,
      "pose_rmse_dtheta": 0.2110539823770523,
      "pose_rmse_dx": 0.09595368057489395,
      "pose_rmse_dy": 0.08925139158964157,
      "pose_rmse_mean": 0.1320863664150238,
      "rmse_dtheta": 0.02415398508310318,
      "rmse_dx": 0.007592306938022375,
      "rmse_dy": 0.00838122982531786,
      "rmse_mean": 0.013375840149819851,
      "rotation_flip": 0.0029133285861462355,
      "sparse_tokens": 32089.0,
      "step": 1502,
      "turn_loss": 0.10123785585165024,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.06982902806169856,
      "grad_norm": 0.5909150242805481,
      "learning_rate": 9.669794884535875e-06,
      "loss": 0.167,
      "mae_dtheta": 0.04236453026533127,
      "mae_dx": 0.009004847146570683,
      "mae_dy": 0.006981257814913988,
      "pose_mae_dtheta": 0.34380966424942017,
      "pose_mae_dx": 0.07486949861049652,
      "pose_mae_dy": 0.05937344208359718,
      "pose_rmse_dtheta": 0.5976352095603943,
      "pose_rmse_dx": 0.18579807877540588,
      "pose_rmse_dy": 0.16450516879558563,
      "pose_rmse_mean": 0.3159795105457306,
      "rmse_dtheta": 0.06338127702474594,
      "rmse_dx": 0.019998935982584953,
      "rmse_dy": 0.016827555373311043,
      "rmse_mean": 0.033402591943740845,
      "rotation_flip": 0.015358361415565014,
      "sparse_tokens": 18126.0,
      "step": 1503,
      "turn_loss": 0.3357372581958771,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.06987548782754135,
      "grad_norm": 0.5298395752906799,
      "learning_rate": 9.669322186282634e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.03716839849948883,
      "mae_dx": 0.010921337641775608,
      "mae_dy": 0.007840101607143879,
      "pose_mae_dtheta": 0.2869734466075897,
      "pose_mae_dx": 0.08865252882242203,
      "pose_mae_dy": 0.06392396241426468,
      "pose_rmse_dtheta": 0.5193449854850769,
      "pose_rmse_dx": 0.17101478576660156,
      "pose_rmse_dy": 0.16376422345638275,
      "pose_rmse_mean": 0.28470802307128906,
      "rmse_dtheta": 0.057364288717508316,
      "rmse_dx": 0.021138882264494896,
      "rmse_dy": 0.017497975379228592,
      "rmse_mean": 0.03200038522481918,
      "rotation_flip": 0.021978022530674934,
      "sparse_tokens": 15727.0,
      "step": 1504,
      "turn_loss": 0.3504614233970642,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.06992194759338413,
      "grad_norm": 0.5374107360839844,
      "learning_rate": 9.668849161501186e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.05050903186202049,
      "mae_dx": 0.011690505780279636,
      "mae_dy": 0.004794894251972437,
      "pose_mae_dtheta": 0.4257358908653259,
      "pose_mae_dx": 0.09379155933856964,
      "pose_mae_dy": 0.054025616496801376,
      "pose_rmse_dtheta": 0.700495183467865,
      "pose_rmse_dx": 0.20123255252838135,
      "pose_rmse_dy": 0.12724649906158447,
      "pose_rmse_mean": 0.342991441488266,
      "rmse_dtheta": 0.07099970430135727,
      "rmse_dx": 0.02388433739542961,
      "rmse_dy": 0.01016372349113226,
      "rmse_mean": 0.03501592203974724,
      "rotation_flip": 0.0077220075763762,
      "sparse_tokens": 12644.0,
      "step": 1505,
      "turn_loss": 0.31802481412887573,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 19742.0,
      "epoch": 0.06996840735922691,
      "grad_norm": 0.8206893801689148,
      "learning_rate": 9.668375810224611e-06,
      "loss": 0.2236,
      "mae_dtheta": 0.03909997642040253,
      "mae_dx": 0.016950532793998718,
      "mae_dy": 0.005092061590403318,
      "pose_mae_dtheta": 0.329744815826416,
      "pose_mae_dx": 0.13455496728420258,
      "pose_mae_dy": 0.08476997911930084,
      "pose_rmse_dtheta": 0.5987083315849304,
      "pose_rmse_dx": 0.27951475977897644,
      "pose_rmse_dy": 0.18342211842536926,
      "pose_rmse_mean": 0.35388171672821045,
      "rmse_dtheta": 0.060379911214113235,
      "rmse_dx": 0.031151706352829933,
      "rmse_dy": 0.009263360872864723,
      "rmse_mean": 0.03359832614660263,
      "rotation_flip": 0.014722537249326706,
      "sparse_tokens": 15005.0,
      "step": 1506,
      "turn_loss": 0.27587467432022095,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07001486712506969,
      "grad_norm": 0.777824878692627,
      "learning_rate": 9.667902132486009e-06,
      "loss": 0.0905,
      "mae_dtheta": 0.011832142248749733,
      "mae_dx": 0.0018807135056704283,
      "mae_dy": 0.003047239501029253,
      "pose_mae_dtheta": 0.08469919115304947,
      "pose_mae_dx": 0.029597416520118713,
      "pose_mae_dy": 0.04420778527855873,
      "pose_rmse_dtheta": 0.1633112132549286,
      "pose_rmse_dx": 0.06739218533039093,
      "pose_rmse_dy": 0.09150296449661255,
      "pose_rmse_mean": 0.10740213096141815,
      "rmse_dtheta": 0.021500956267118454,
      "rmse_dx": 0.005633921828120947,
      "rmse_dy": 0.005580538418143988,
      "rmse_mean": 0.010905139148235321,
      "rotation_flip": 0.0056597101502120495,
      "sparse_tokens": 32089.0,
      "step": 1507,
      "turn_loss": 0.09979040175676346,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.07006132689091248,
      "grad_norm": 0.6732131838798523,
      "learning_rate": 9.667428128318507e-06,
      "loss": 0.1363,
      "mae_dtheta": 0.008457925170660019,
      "mae_dx": 0.0019435762660577893,
      "mae_dy": 0.001738984021358192,
      "pose_mae_dtheta": 0.06310024112462997,
      "pose_mae_dx": 0.025850331410765648,
      "pose_mae_dy": 0.022567151114344597,
      "pose_rmse_dtheta": 0.16075995564460754,
      "pose_rmse_dx": 0.0677487701177597,
      "pose_rmse_dy": 0.05984299257397652,
      "pose_rmse_mean": 0.09611724317073822,
      "rmse_dtheta": 0.020221401005983353,
      "rmse_dx": 0.005679801106452942,
      "rmse_dy": 0.004184023477137089,
      "rmse_mean": 0.010028408840298653,
      "rotation_flip": 0.00327332247979939,
      "sparse_tokens": 32137.0,
      "step": 1508,
      "turn_loss": 0.06940850615501404,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07010778665675525,
      "grad_norm": 0.6103626489639282,
      "learning_rate": 9.66695379775525e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.016231048852205276,
      "mae_dx": 0.00474087567999959,
      "mae_dy": 0.0034085637889802456,
      "pose_mae_dtheta": 0.1219063475728035,
      "pose_mae_dx": 0.04513197019696236,
      "pose_mae_dy": 0.046287450939416885,
      "pose_rmse_dtheta": 0.3101472854614258,
      "pose_rmse_dx": 0.12267179787158966,
      "pose_rmse_dy": 0.16122525930404663,
      "pose_rmse_mean": 0.1980147808790207,
      "rmse_dtheta": 0.034616414457559586,
      "rmse_dx": 0.013409378007054329,
      "rmse_dy": 0.01053970493376255,
      "rmse_mean": 0.01952183246612549,
      "rotation_flip": 0.007197696715593338,
      "sparse_tokens": 32121.0,
      "step": 1509,
      "turn_loss": 0.1570485234260559,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07015424642259803,
      "grad_norm": 0.516883373260498,
      "learning_rate": 9.666479140829408e-06,
      "loss": 0.1497,
      "mae_dtheta": 0.011325602419674397,
      "mae_dx": 0.0021518187131732702,
      "mae_dy": 0.0024480558931827545,
      "pose_mae_dtheta": 0.09478428214788437,
      "pose_mae_dx": 0.025362277403473854,
      "pose_mae_dy": 0.03402804955840111,
      "pose_rmse_dtheta": 0.2603287696838379,
      "pose_rmse_dx": 0.07383172959089279,
      "pose_rmse_dy": 0.09608137607574463,
      "pose_rmse_mean": 0.1434139609336853,
      "rmse_dtheta": 0.027348127216100693,
      "rmse_dx": 0.006617442704737186,
      "rmse_dy": 0.0064827254973351955,
      "rmse_mean": 0.01348276436328888,
      "rotation_flip": 0.006525285542011261,
      "sparse_tokens": 32089.0,
      "step": 1510,
      "turn_loss": 0.08752746134996414,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.0702007061884408,
      "grad_norm": 0.7466806769371033,
      "learning_rate": 9.666004157574177e-06,
      "loss": 0.169,
      "mae_dtheta": 0.009121709503233433,
      "mae_dx": 0.002016460057348013,
      "mae_dy": 0.001708421390503645,
      "pose_mae_dtheta": 0.0642353817820549,
      "pose_mae_dx": 0.020197726786136627,
      "pose_mae_dy": 0.022444335743784904,
      "pose_rmse_dtheta": 0.17603860795497894,
      "pose_rmse_dx": 0.05379968881607056,
      "pose_rmse_dy": 0.05210285261273384,
      "pose_rmse_mean": 0.09398038685321808,
      "rmse_dtheta": 0.02313791960477829,
      "rmse_dx": 0.0061509390361607075,
      "rmse_dy": 0.004705526866018772,
      "rmse_mean": 0.011331461369991302,
      "rotation_flip": 0.004856726620346308,
      "sparse_tokens": 32137.0,
      "step": 1511,
      "turn_loss": 0.06919252872467041,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.0702471659542836,
      "grad_norm": 0.6357041597366333,
      "learning_rate": 9.665528848022769e-06,
      "loss": 0.1129,
      "mae_dtheta": 0.010163556784391403,
      "mae_dx": 0.0024468787014484406,
      "mae_dy": 0.0023114499635994434,
      "pose_mae_dtheta": 0.07758910208940506,
      "pose_mae_dx": 0.030856965109705925,
      "pose_mae_dy": 0.030547678470611572,
      "pose_rmse_dtheta": 0.17127615213394165,
      "pose_rmse_dx": 0.06517527997493744,
      "pose_rmse_dy": 0.08156069368124008,
      "pose_rmse_mean": 0.10600404441356659,
      "rmse_dtheta": 0.02095883898437023,
      "rmse_dx": 0.006149195600301027,
      "rmse_dy": 0.005279227625578642,
      "rmse_mean": 0.010795753449201584,
      "rotation_flip": 0.00192381686065346,
      "sparse_tokens": 32185.0,
      "step": 1512,
      "turn_loss": 0.09074001759290695,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.07029362572012637,
      "grad_norm": 0.7466833591461182,
      "learning_rate": 9.665053212208426e-06,
      "loss": 0.1729,
      "mae_dtheta": 0.05398426204919815,
      "mae_dx": 0.017293084412813187,
      "mae_dy": 0.0064778621308505535,
      "pose_mae_dtheta": 0.55826735496521,
      "pose_mae_dx": 0.16109025478363037,
      "pose_mae_dy": 0.11605045944452286,
      "pose_rmse_dtheta": 0.8231661319732666,
      "pose_rmse_dx": 0.2935369610786438,
      "pose_rmse_dy": 0.2214183807373047,
      "pose_rmse_mean": 0.44604048132896423,
      "rmse_dtheta": 0.07110083103179932,
      "rmse_dx": 0.029070835560560226,
      "rmse_dy": 0.010797718539834023,
      "rmse_mean": 0.03698979690670967,
      "rotation_flip": 0.006289307959377766,
      "sparse_tokens": 2703.0,
      "step": 1513,
      "turn_loss": 0.32226312160491943,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07034008548596915,
      "grad_norm": 0.4396335184574127,
      "learning_rate": 9.664577250164407e-06,
      "loss": 0.1233,
      "mae_dtheta": 0.013931510038673878,
      "mae_dx": 0.002765531884506345,
      "mae_dy": 0.004017760045826435,
      "pose_mae_dtheta": 0.10224896669387817,
      "pose_mae_dx": 0.032170649617910385,
      "pose_mae_dy": 0.048429567366838455,
      "pose_rmse_dtheta": 0.23127715289592743,
      "pose_rmse_dx": 0.08512956649065018,
      "pose_rmse_dy": 0.13845112919807434,
      "pose_rmse_mean": 0.15161928534507751,
      "rmse_dtheta": 0.0281645767390728,
      "rmse_dx": 0.007610376458615065,
      "rmse_dy": 0.010571951046586037,
      "rmse_mean": 0.015448967926204205,
      "rotation_flip": 0.004098360426723957,
      "sparse_tokens": 32105.0,
      "step": 1514,
      "turn_loss": 0.12096086889505386,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.07038654525181193,
      "grad_norm": 0.9025996923446655,
      "learning_rate": 9.664100961923998e-06,
      "loss": 0.3133,
      "mae_dtheta": 0.0412985123693943,
      "mae_dx": 0.017138201743364334,
      "mae_dy": 0.003957738168537617,
      "pose_mae_dtheta": 0.33603763580322266,
      "pose_mae_dx": 0.14912772178649902,
      "pose_mae_dy": 0.04656170681118965,
      "pose_rmse_dtheta": 0.5786593556404114,
      "pose_rmse_dx": 0.29375123977661133,
      "pose_rmse_dy": 0.09320133179426193,
      "pose_rmse_mean": 0.3218706548213959,
      "rmse_dtheta": 0.06102970987558365,
      "rmse_dx": 0.030174892395734787,
      "rmse_dy": 0.00703674741089344,
      "rmse_mean": 0.032747115939855576,
      "rotation_flip": 0.017006803303956985,
      "sparse_tokens": 10840.0,
      "step": 1515,
      "turn_loss": 0.2948630452156067,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.07043300501765472,
      "grad_norm": 0.915956437587738,
      "learning_rate": 9.663624347520506e-06,
      "loss": 0.2048,
      "mae_dtheta": 0.032597947865724564,
      "mae_dx": 0.010842819698154926,
      "mae_dy": 0.003909564111381769,
      "pose_mae_dtheta": 0.2762686610221863,
      "pose_mae_dx": 0.0764697939157486,
      "pose_mae_dy": 0.05007099732756615,
      "pose_rmse_dtheta": 0.4992479681968689,
      "pose_rmse_dx": 0.17612242698669434,
      "pose_rmse_dy": 0.1378728151321411,
      "pose_rmse_mean": 0.2710810899734497,
      "rmse_dtheta": 0.05187816545367241,
      "rmse_dx": 0.02267681434750557,
      "rmse_dy": 0.008402928709983826,
      "rmse_mean": 0.027652636170387268,
      "rotation_flip": 0.01096224132925272,
      "sparse_tokens": 14529.0,
      "step": 1516,
      "turn_loss": 0.2149566262960434,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.0704794647834975,
      "grad_norm": 0.8188275694847107,
      "learning_rate": 9.663147406987258e-06,
      "loss": 0.21,
      "mae_dtheta": 0.016141925007104874,
      "mae_dx": 0.005099423695355654,
      "mae_dy": 0.005426439456641674,
      "pose_mae_dtheta": 0.11836037784814835,
      "pose_mae_dx": 0.06253684312105179,
      "pose_mae_dy": 0.06489929556846619,
      "pose_rmse_dtheta": 0.25413382053375244,
      "pose_rmse_dx": 0.16771800816059113,
      "pose_rmse_dy": 0.17258499562740326,
      "pose_rmse_mean": 0.19814561307430267,
      "rmse_dtheta": 0.029884343966841698,
      "rmse_dx": 0.01656848005950451,
      "rmse_dy": 0.011945681646466255,
      "rmse_mean": 0.01946616917848587,
      "rotation_flip": 0.012573674321174622,
      "sparse_tokens": 32057.0,
      "step": 1517,
      "turn_loss": 0.18888668715953827,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.07052592454934027,
      "grad_norm": 0.7931333184242249,
      "learning_rate": 9.662670140357611e-06,
      "loss": 0.1273,
      "mae_dtheta": 0.010699739679694176,
      "mae_dx": 0.002681675599887967,
      "mae_dy": 0.0024604080244898796,
      "pose_mae_dtheta": 0.0778314620256424,
      "pose_mae_dx": 0.03299567103385925,
      "pose_mae_dy": 0.031857311725616455,
      "pose_rmse_dtheta": 0.160414457321167,
      "pose_rmse_dx": 0.072397381067276,
      "pose_rmse_dy": 0.07022211700677872,
      "pose_rmse_mean": 0.10101132094860077,
      "rmse_dtheta": 0.021085580810904503,
      "rmse_dx": 0.00711866607889533,
      "rmse_dy": 0.005136067979037762,
      "rmse_mean": 0.011113438755273819,
      "rotation_flip": 0.0034000754822045565,
      "sparse_tokens": 32137.0,
      "step": 1518,
      "turn_loss": 0.08679334819316864,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.07057238431518305,
      "grad_norm": 0.9491114020347595,
      "learning_rate": 9.662192547664938e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.01175125502049923,
      "mae_dx": 0.002637286437675357,
      "mae_dy": 0.0016198726370930672,
      "pose_mae_dtheta": 0.09146295487880707,
      "pose_mae_dx": 0.028841817751526833,
      "pose_mae_dy": 0.02761165425181389,
      "pose_rmse_dtheta": 0.22445248067378998,
      "pose_rmse_dx": 0.06705702841281891,
      "pose_rmse_dy": 0.07517095655202866,
      "pose_rmse_mean": 0.12222682684659958,
      "rmse_dtheta": 0.026797393336892128,
      "rmse_dx": 0.0075742751359939575,
      "rmse_dy": 0.0036225535441190004,
      "rmse_mean": 0.012664740905165672,
      "rotation_flip": 0.007352941203862429,
      "sparse_tokens": 32169.0,
      "step": 1519,
      "turn_loss": 0.09234984964132309,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.07061884408102582,
      "grad_norm": 0.5966533422470093,
      "learning_rate": 9.661714628942637e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.04000338539481163,
      "mae_dx": 0.01408789400011301,
      "mae_dy": 0.008620512671768665,
      "pose_mae_dtheta": 0.33853650093078613,
      "pose_mae_dx": 0.1127830222249031,
      "pose_mae_dy": 0.11249102652072906,
      "pose_rmse_dtheta": 0.5889231562614441,
      "pose_rmse_dx": 0.24499663710594177,
      "pose_rmse_dy": 0.2449076920747757,
      "pose_rmse_mean": 0.3596091866493225,
      "rmse_dtheta": 0.05946539714932442,
      "rmse_dx": 0.027570346370339394,
      "rmse_dy": 0.0160804633051157,
      "rmse_mean": 0.03437206894159317,
      "rotation_flip": 0.014231499284505844,
      "sparse_tokens": 18649.0,
      "step": 1520,
      "turn_loss": 0.30789709091186523,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07066530384686862,
      "grad_norm": 0.7636188268661499,
      "learning_rate": 9.66123638422413e-06,
      "loss": 0.081,
      "mae_dtheta": 0.01086934469640255,
      "mae_dx": 0.0014953172067180276,
      "mae_dy": 0.0025237509980797768,
      "pose_mae_dtheta": 0.0751299187541008,
      "pose_mae_dx": 0.022632533684372902,
      "pose_mae_dy": 0.03478522226214409,
      "pose_rmse_dtheta": 0.17340362071990967,
      "pose_rmse_dx": 0.05980784446001053,
      "pose_rmse_dy": 0.08246808499097824,
      "pose_rmse_mean": 0.10522651672363281,
      "rmse_dtheta": 0.0216497965157032,
      "rmse_dx": 0.004521422553807497,
      "rmse_dy": 0.0049462467432022095,
      "rmse_mean": 0.010372488759458065,
      "rotation_flip": 0.0011695906287059188,
      "sparse_tokens": 32073.0,
      "step": 1521,
      "turn_loss": 0.08110260218381882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.07071176361271139,
      "grad_norm": 0.6842394471168518,
      "learning_rate": 9.66075781354286e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.035025354474782944,
      "mae_dx": 0.007371958810836077,
      "mae_dy": 0.0038088862784206867,
      "pose_mae_dtheta": 0.276394248008728,
      "pose_mae_dx": 0.04608204960823059,
      "pose_mae_dy": 0.04891747236251831,
      "pose_rmse_dtheta": 0.5079361200332642,
      "pose_rmse_dx": 0.12781694531440735,
      "pose_rmse_dy": 0.13642893731594086,
      "pose_rmse_mean": 0.257394015789032,
      "rmse_dtheta": 0.054707109928131104,
      "rmse_dx": 0.017835618928074837,
      "rmse_dy": 0.007463508285582066,
      "rmse_mean": 0.026668746024370193,
      "rotation_flip": 0.017241379246115685,
      "sparse_tokens": 9637.0,
      "step": 1522,
      "turn_loss": 0.20242176949977875,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.07075822337855417,
      "grad_norm": 0.7797169089317322,
      "learning_rate": 9.660278916932298e-06,
      "loss": 0.1539,
      "mae_dtheta": 0.007698705419898033,
      "mae_dx": 0.0030628079548478127,
      "mae_dy": 0.0008535239030607045,
      "pose_mae_dtheta": 0.05476837605237961,
      "pose_mae_dx": 0.02665594033896923,
      "pose_mae_dy": 0.011777314357459545,
      "pose_rmse_dtheta": 0.14311176538467407,
      "pose_rmse_dx": 0.06431778520345688,
      "pose_rmse_dy": 0.03300033137202263,
      "pose_rmse_mean": 0.08014330267906189,
      "rmse_dtheta": 0.020967060700058937,
      "rmse_dx": 0.007897785864770412,
      "rmse_dy": 0.002009193180128932,
      "rmse_mean": 0.010291346348822117,
      "rotation_flip": 0.002391200279816985,
      "sparse_tokens": 32249.0,
      "step": 1523,
      "turn_loss": 0.0667991116642952,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32439.0,
      "epoch": 0.07080468314439695,
      "grad_norm": 0.5055530071258545,
      "learning_rate": 9.659799694425926e-06,
      "loss": 0.1448,
      "mae_dtheta": 0.03797193244099617,
      "mae_dx": 0.013436947017908096,
      "mae_dy": 0.00552620692178607,
      "pose_mae_dtheta": 0.3076156675815582,
      "pose_mae_dx": 0.11447443068027496,
      "pose_mae_dy": 0.05977434664964676,
      "pose_rmse_dtheta": 0.517111599445343,
      "pose_rmse_dx": 0.22690549492835999,
      "pose_rmse_dy": 0.15448692440986633,
      "pose_rmse_mean": 0.29950135946273804,
      "rmse_dtheta": 0.056631900370121,
      "rmse_dx": 0.02543584443628788,
      "rmse_dy": 0.012463361956179142,
      "rmse_mean": 0.0315103679895401,
      "rotation_flip": 0.012459016405045986,
      "sparse_tokens": 23637.0,
      "step": 1524,
      "turn_loss": 0.34011101722717285,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.07085114291023974,
      "grad_norm": 0.4806765615940094,
      "learning_rate": 9.659320146057263e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.008735250681638718,
      "mae_dx": 0.0019742026925086975,
      "mae_dy": 0.0008189526270143688,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4806763827800751,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.8104705810547,
      "model/head/act_norm_mean": 124.35821101641415,
      "model/head/act_norm_min": 81.7439193725586,
      "model/head/act_over_embed": 85.46012687039455,
      "model/head/grad_frac": 0.10830122977495193,
      "model/head/grad_norm": 0.052057843655347824,
      "model/head/grad_zero_frac": 0.00019575668557081372,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6804914378156566,
      "model/head/update_ratio": 0.0009052748791873455,
      "model/head/weight_delta": 4.412635326385498,
      "model/head/weight_delta_rel": 0.07741069048643112,
      "model/head/weight_norm": 57.50501251220703,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4130667746067047,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41299347573138295,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41291216015815735,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28381298302844393,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1144978478550911,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05503641068935394,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5375,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017912263283506036,
      "model/modality_embedder.encoders.pose/weight_delta": 1.4203957319259644,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0464087538421154,
      "model/modality_embedder.encoders.pose/weight_norm": 30.725547790527344,
      "model/modality_embedder/grad_frac": 0.1144978478550911,
      "model/modality_embedder/grad_norm": 0.05503641068935394,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5375,
      "model/modality_embedder/update_ratio": 0.0017912263283506036,
      "model/modality_embedder/weight_delta": 1.4203957319259644,
      "model/modality_embedder/weight_delta_rel": 0.0464087538421154,
      "model/modality_embedder/weight_norm": 30.725547790527344,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.03492736816406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.745400432900432,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.951971054077148,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.00527084757805,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10104963928461075,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.048572175204753876,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017621289007365704,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.8057007789611816,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.029360221698880196,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.564485549926758,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.24495697021484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.8488455988456,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.285425186157227,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.763568696231975,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0977809801697731,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.047001007944345474,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016155808698385954,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 0.993776798248291,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.03442520648241043,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.092327117919922,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.0781478881836,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.728089426006093,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.211586952209473,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.05500264801457,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10470540076494217,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05032941326498985,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016764766769483685,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.0512614250183105,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0352993905544281,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.020944595336914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.88301849365234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.52689594356261,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.540252685546875,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.291159327571357,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.13247250020503998,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06367640197277069,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002163324970752001,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.8956295251846313,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.030608367174863815,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.434505462646484,
      "model/normalizer/grad_frac": 0.5654116272926331,
      "model/normalizer/grad_norm": 0.27178001403808594,
      "model/normalizer/grad_zero_frac": 0.00013708166079595685,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0034890768583863974,
      "model/normalizer/weight_delta": 1.928659439086914,
      "model/normalizer/weight_delta_rel": 0.024840017780661583,
      "model/normalizer/weight_norm": 77.89453125,
      "pose_mae_dtheta": 0.06372333317995071,
      "pose_mae_dx": 0.017560306936502457,
      "pose_mae_dy": 0.01221451349556446,
      "pose_rmse_dtheta": 0.21331284940242767,
      "pose_rmse_dx": 0.04017166420817375,
      "pose_rmse_dy": 0.03234054148197174,
      "pose_rmse_mean": 0.09527502954006195,
      "rmse_dtheta": 0.02662993222475052,
      "rmse_dx": 0.0054613384418189526,
      "rmse_dy": 0.001481314073316753,
      "rmse_mean": 0.011190861463546753,
      "rotation_flip": 0.0031088083051145077,
      "sparse_tokens": 32201.0,
      "step": 1525,
      "turn_loss": 0.05771564692258835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.07089760267608251,
      "grad_norm": 0.7551258206367493,
      "learning_rate": 9.65884027185984e-06,
      "loss": 0.1366,
      "mae_dtheta": 0.04355771839618683,
      "mae_dx": 0.017708199098706245,
      "mae_dy": 0.0015751422615721822,
      "pose_mae_dtheta": 0.3684796392917633,
      "pose_mae_dx": 0.1487417221069336,
      "pose_mae_dy": 0.015056341886520386,
      "pose_rmse_dtheta": 0.6110987663269043,
      "pose_rmse_dx": 0.2841724157333374,
      "pose_rmse_dy": 0.02913503907620907,
      "pose_rmse_mean": 0.30813542008399963,
      "rmse_dtheta": 0.06127304211258888,
      "rmse_dx": 0.03059946373105049,
      "rmse_dy": 0.003572330344468355,
      "rmse_mean": 0.031814947724342346,
      "rotation_flip": 0.0076045626774430275,
      "sparse_tokens": 5029.0,
      "step": 1526,
      "turn_loss": 0.28693151473999023,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07094406244192529,
      "grad_norm": 0.8241389989852905,
      "learning_rate": 9.658360071867216e-06,
      "loss": 0.1183,
      "mae_dtheta": 0.011868310160934925,
      "mae_dx": 0.0032954381313174963,
      "mae_dy": 0.003562057623639703,
      "pose_mae_dtheta": 0.08027113974094391,
      "pose_mae_dx": 0.03687581419944763,
      "pose_mae_dy": 0.030945325270295143,
      "pose_rmse_dtheta": 0.19236811995506287,
      "pose_rmse_dx": 0.09859969466924667,
      "pose_rmse_dy": 0.09370715171098709,
      "pose_rmse_mean": 0.12822499871253967,
      "rmse_dtheta": 0.025030983611941338,
      "rmse_dx": 0.009371746331453323,
      "rmse_dy": 0.00902471598237753,
      "rmse_mean": 0.014475814998149872,
      "rotation_flip": 0.0030052592046558857,
      "sparse_tokens": 32089.0,
      "step": 1527,
      "turn_loss": 0.11286864429712296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07099052220776807,
      "grad_norm": 0.6269464492797852,
      "learning_rate": 9.657879546112973e-06,
      "loss": 0.0914,
      "mae_dtheta": 0.013680304400622845,
      "mae_dx": 0.0025977767072618008,
      "mae_dy": 0.002805078634992242,
      "pose_mae_dtheta": 0.09920260310173035,
      "pose_mae_dx": 0.028048686683177948,
      "pose_mae_dy": 0.03852689266204834,
      "pose_rmse_dtheta": 0.24065935611724854,
      "pose_rmse_dx": 0.07415378093719482,
      "pose_rmse_dy": 0.09077233076095581,
      "pose_rmse_mean": 0.13519516587257385,
      "rmse_dtheta": 0.029751678928732872,
      "rmse_dx": 0.00779541302472353,
      "rmse_dy": 0.006124772131443024,
      "rmse_mean": 0.014557288959622383,
      "rotation_flip": 0.005323505494743586,
      "sparse_tokens": 32073.0,
      "step": 1528,
      "turn_loss": 0.1086052805185318,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07103698197361086,
      "grad_norm": 0.4591476619243622,
      "learning_rate": 9.657398694630713e-06,
      "loss": 0.1154,
      "mae_dtheta": 0.00982258003205061,
      "mae_dx": 0.0019272428471595049,
      "mae_dy": 0.001909903367049992,
      "pose_mae_dtheta": 0.07100152224302292,
      "pose_mae_dx": 0.02270505763590336,
      "pose_mae_dy": 0.02483200840651989,
      "pose_rmse_dtheta": 0.21535763144493103,
      "pose_rmse_dx": 0.05820915102958679,
      "pose_rmse_dy": 0.06855141371488571,
      "pose_rmse_mean": 0.11403940618038177,
      "rmse_dtheta": 0.023276783525943756,
      "rmse_dx": 0.005746060516685247,
      "rmse_dy": 0.00421294616535306,
      "rmse_mean": 0.011078597977757454,
      "rotation_flip": 0.005679513327777386,
      "sparse_tokens": 32105.0,
      "step": 1529,
      "turn_loss": 0.06773705035448074,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8439.0,
      "epoch": 0.07108344173945363,
      "grad_norm": 1.3607844114303589,
      "learning_rate": 9.656917517454063e-06,
      "loss": 0.3094,
      "mae_dtheta": 0.036876317113637924,
      "mae_dx": 0.015189409255981445,
      "mae_dy": 0.009356832131743431,
      "pose_mae_dtheta": 0.2745085060596466,
      "pose_mae_dx": 0.11631958931684494,
      "pose_mae_dy": 0.11534228920936584,
      "pose_rmse_dtheta": 0.5035450458526611,
      "pose_rmse_dx": 0.24109847843647003,
      "pose_rmse_dy": 0.20537254214286804,
      "pose_rmse_mean": 0.31667202711105347,
      "rmse_dtheta": 0.053204748779535294,
      "rmse_dx": 0.027195025235414505,
      "rmse_dy": 0.016443690285086632,
      "rmse_mean": 0.03228115662932396,
      "rotation_flip": 0.01923076994717121,
      "sparse_tokens": 7213.0,
      "step": 1530,
      "turn_loss": 0.43196356296539307,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07112990150529641,
      "grad_norm": 0.5120390057563782,
      "learning_rate": 9.65643601461667e-06,
      "loss": 0.1102,
      "mae_dtheta": 0.013579602353274822,
      "mae_dx": 0.002452149987220764,
      "mae_dy": 0.003245132276788354,
      "pose_mae_dtheta": 0.09674514830112457,
      "pose_mae_dx": 0.0313987210392952,
      "pose_mae_dy": 0.03847115486860275,
      "pose_rmse_dtheta": 0.21671336889266968,
      "pose_rmse_dx": 0.07938969135284424,
      "pose_rmse_dy": 0.08474639803171158,
      "pose_rmse_mean": 0.12694981694221497,
      "rmse_dtheta": 0.025735534727573395,
      "rmse_dx": 0.007566168438643217,
      "rmse_dy": 0.007122342474758625,
      "rmse_mean": 0.013474682345986366,
      "rotation_flip": 0.0059602647088468075,
      "sparse_tokens": 32105.0,
      "step": 1531,
      "turn_loss": 0.1133517175912857,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.07117636127113919,
      "grad_norm": 0.5486570596694946,
      "learning_rate": 9.655954186152208e-06,
      "loss": 0.1147,
      "mae_dtheta": 0.01052439771592617,
      "mae_dx": 0.0022793984971940517,
      "mae_dy": 0.0023817340843379498,
      "pose_mae_dtheta": 0.07107408344745636,
      "pose_mae_dx": 0.028698699548840523,
      "pose_mae_dy": 0.027287935838103294,
      "pose_rmse_dtheta": 0.18208833038806915,
      "pose_rmse_dx": 0.08631359040737152,
      "pose_rmse_dy": 0.0737714022397995,
      "pose_rmse_mean": 0.11405777931213379,
      "rmse_dtheta": 0.024839848279953003,
      "rmse_dx": 0.0077577936463057995,
      "rmse_dy": 0.005889836233109236,
      "rmse_mean": 0.012829160317778587,
      "rotation_flip": 0.00828157365322113,
      "sparse_tokens": 32041.0,
      "step": 1532,
      "turn_loss": 0.07816354930400848,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07122282103698198,
      "grad_norm": 0.6645532250404358,
      "learning_rate": 9.65547203209437e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.013916661962866783,
      "mae_dx": 0.0030017136596143246,
      "mae_dy": 0.004840667825192213,
      "pose_mae_dtheta": 0.10293284058570862,
      "pose_mae_dx": 0.048006173223257065,
      "pose_mae_dy": 0.051668163388967514,
      "pose_rmse_dtheta": 0.20458193123340607,
      "pose_rmse_dx": 0.11237122863531113,
      "pose_rmse_dy": 0.10568855702877045,
      "pose_rmse_mean": 0.14088056981563568,
      "rmse_dtheta": 0.026861997321248055,
      "rmse_dx": 0.007337098941206932,
      "rmse_dy": 0.009589598514139652,
      "rmse_mean": 0.014596231281757355,
      "rotation_flip": 0.003559985663741827,
      "sparse_tokens": 32105.0,
      "step": 1533,
      "turn_loss": 0.1283961981534958,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.07126928080282476,
      "grad_norm": 0.5446022152900696,
      "learning_rate": 9.654989552476874e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.011028405278921127,
      "mae_dx": 0.0027678697369992733,
      "mae_dy": 0.001804598025046289,
      "pose_mae_dtheta": 0.07923530042171478,
      "pose_mae_dx": 0.029998280107975006,
      "pose_mae_dy": 0.02482282929122448,
      "pose_rmse_dtheta": 0.21240311861038208,
      "pose_rmse_dx": 0.09144632518291473,
      "pose_rmse_dy": 0.06337504833936691,
      "pose_rmse_mean": 0.1224081739783287,
      "rmse_dtheta": 0.02518097683787346,
      "rmse_dx": 0.009495686739683151,
      "rmse_dy": 0.0043161953799426556,
      "rmse_mean": 0.012997619807720184,
      "rotation_flip": 0.00561797758564353,
      "sparse_tokens": 32057.0,
      "step": 1534,
      "turn_loss": 0.07800838351249695,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.07131574056866753,
      "grad_norm": 0.49288174510002136,
      "learning_rate": 9.654506747333461e-06,
      "loss": 0.1281,
      "mae_dtheta": 0.04311832785606384,
      "mae_dx": 0.00893861148506403,
      "mae_dy": 0.004762477707117796,
      "pose_mae_dtheta": 0.38531169295310974,
      "pose_mae_dx": 0.06778188049793243,
      "pose_mae_dy": 0.0473121702671051,
      "pose_rmse_dtheta": 0.6142863035202026,
      "pose_rmse_dx": 0.17522217333316803,
      "pose_rmse_dy": 0.10436506569385529,
      "pose_rmse_mean": 0.2979578375816345,
      "rmse_dtheta": 0.0622343011200428,
      "rmse_dx": 0.019974637776613235,
      "rmse_dy": 0.010168978944420815,
      "rmse_mean": 0.030792638659477234,
      "rotation_flip": 0.010781670920550823,
      "sparse_tokens": 6581.0,
      "step": 1535,
      "turn_loss": 0.2873353064060211,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.07136220033451031,
      "grad_norm": 0.464461088180542,
      "learning_rate": 9.654023616697895e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.03588152676820755,
      "mae_dx": 0.016820687800645828,
      "mae_dy": 0.004006972070783377,
      "pose_mae_dtheta": 0.2934231460094452,
      "pose_mae_dx": 0.12950526177883148,
      "pose_mae_dy": 0.041665732860565186,
      "pose_rmse_dtheta": 0.5199583172798157,
      "pose_rmse_dx": 0.2702683210372925,
      "pose_rmse_dy": 0.09255712479352951,
      "pose_rmse_mean": 0.29426127672195435,
      "rmse_dtheta": 0.05333812162280083,
      "rmse_dx": 0.030406540259718895,
      "rmse_dy": 0.0077029503881931305,
      "rmse_mean": 0.030482536181807518,
      "rotation_flip": 0.016771487891674042,
      "sparse_tokens": 8073.0,
      "step": 1536,
      "turn_loss": 0.22976946830749512,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.0714086601003531,
      "grad_norm": 0.5163857936859131,
      "learning_rate": 9.653540160603956e-06,
      "loss": 0.1129,
      "mae_dtheta": 0.006513617467135191,
      "mae_dx": 0.0014004540862515569,
      "mae_dy": 0.0013878128957003355,
      "pose_mae_dtheta": 0.049316152930259705,
      "pose_mae_dx": 0.018561460077762604,
      "pose_mae_dy": 0.020243914797902107,
      "pose_rmse_dtheta": 0.14120973646640778,
      "pose_rmse_dx": 0.05294637754559517,
      "pose_rmse_dy": 0.05608859658241272,
      "pose_rmse_mean": 0.08341490477323532,
      "rmse_dtheta": 0.01626746542751789,
      "rmse_dx": 0.004582335706800222,
      "rmse_dy": 0.0031026771757751703,
      "rmse_mean": 0.007984159514307976,
      "rotation_flip": 0.006703910417854786,
      "sparse_tokens": 32073.0,
      "step": 1537,
      "turn_loss": 0.050256986171007156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07145511986619588,
      "grad_norm": 0.5180188417434692,
      "learning_rate": 9.653056379085457e-06,
      "loss": 0.1188,
      "mae_dtheta": 0.012917257845401764,
      "mae_dx": 0.002975143026560545,
      "mae_dy": 0.0033664891961961985,
      "pose_mae_dtheta": 0.10049095004796982,
      "pose_mae_dx": 0.03582848235964775,
      "pose_mae_dy": 0.04491600766777992,
      "pose_rmse_dtheta": 0.20729008316993713,
      "pose_rmse_dx": 0.10506691783666611,
      "pose_rmse_dy": 0.09946804493665695,
      "pose_rmse_mean": 0.13727502524852753,
      "rmse_dtheta": 0.02485511638224125,
      "rmse_dx": 0.009189966134727001,
      "rmse_dy": 0.007385564967989922,
      "rmse_mean": 0.013810215517878532,
      "rotation_flip": 0.004048583097755909,
      "sparse_tokens": 32121.0,
      "step": 1538,
      "turn_loss": 0.12268473207950592,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07150157963203865,
      "grad_norm": 0.5499749779701233,
      "learning_rate": 9.652572272176228e-06,
      "loss": 0.1507,
      "mae_dtheta": 0.012841991148889065,
      "mae_dx": 0.0022875748109072447,
      "mae_dy": 0.002971459412947297,
      "pose_mae_dtheta": 0.09915857017040253,
      "pose_mae_dx": 0.03057072125375271,
      "pose_mae_dy": 0.03389770910143852,
      "pose_rmse_dtheta": 0.25899797677993774,
      "pose_rmse_dx": 0.07866441458463669,
      "pose_rmse_dy": 0.08199076354503632,
      "pose_rmse_mean": 0.13988439738750458,
      "rmse_dtheta": 0.028330860659480095,
      "rmse_dx": 0.0063340975902974606,
      "rmse_dy": 0.007407744415104389,
      "rmse_mean": 0.014024234376847744,
      "rotation_flip": 0.005256772972643375,
      "sparse_tokens": 32073.0,
      "step": 1539,
      "turn_loss": 0.12264448404312134,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07154803939788143,
      "grad_norm": 0.5448281168937683,
      "learning_rate": 9.652087839910123e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.008283346891403198,
      "mae_dx": 0.0012978787999600172,
      "mae_dy": 0.0014212989481166005,
      "pose_mae_dtheta": 0.05681201443076134,
      "pose_mae_dx": 0.017162444069981575,
      "pose_mae_dy": 0.02125163935124874,
      "pose_rmse_dtheta": 0.16430224478244781,
      "pose_rmse_dx": 0.04573557525873184,
      "pose_rmse_dy": 0.05132432281970978,
      "pose_rmse_mean": 0.08712071180343628,
      "rmse_dtheta": 0.020247487351298332,
      "rmse_dx": 0.004454535897821188,
      "rmse_dy": 0.003134242258965969,
      "rmse_mean": 0.009278755635023117,
      "rotation_flip": 0.0018841262208297849,
      "sparse_tokens": 32073.0,
      "step": 1540,
      "turn_loss": 0.059959448873996735,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07159449916372422,
      "grad_norm": 0.5652503967285156,
      "learning_rate": 9.651603082321019e-06,
      "loss": 0.1539,
      "mae_dtheta": 0.008097171783447266,
      "mae_dx": 0.0013162714894860983,
      "mae_dy": 0.0012751631438732147,
      "pose_mae_dtheta": 0.05043226480484009,
      "pose_mae_dx": 0.01584445871412754,
      "pose_mae_dy": 0.016784176230430603,
      "pose_rmse_dtheta": 0.14191947877407074,
      "pose_rmse_dx": 0.03871901333332062,
      "pose_rmse_dy": 0.039770349860191345,
      "pose_rmse_mean": 0.0734696164727211,
      "rmse_dtheta": 0.021369870752096176,
      "rmse_dx": 0.004308733157813549,
      "rmse_dy": 0.002946598920971155,
      "rmse_mean": 0.009541735053062439,
      "rotation_flip": 0.0020833334419876337,
      "sparse_tokens": 32105.0,
      "step": 1541,
      "turn_loss": 0.06319819390773773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.071640958929567,
      "grad_norm": 0.6490063071250916,
      "learning_rate": 9.651117999442814e-06,
      "loss": 0.1078,
      "mae_dtheta": 0.010466503910720348,
      "mae_dx": 0.002546553732827306,
      "mae_dy": 0.002035463461652398,
      "pose_mae_dtheta": 0.0754302367568016,
      "pose_mae_dx": 0.028952473774552345,
      "pose_mae_dy": 0.02730409987270832,
      "pose_rmse_dtheta": 0.18956208229064941,
      "pose_rmse_dx": 0.07629090547561646,
      "pose_rmse_dy": 0.07170827686786652,
      "pose_rmse_mean": 0.11252041906118393,
      "rmse_dtheta": 0.023010388016700745,
      "rmse_dx": 0.008126267232000828,
      "rmse_dy": 0.004383368417620659,
      "rmse_mean": 0.011840008199214935,
      "rotation_flip": 0.006862745154649019,
      "sparse_tokens": 32073.0,
      "step": 1542,
      "turn_loss": 0.08094406127929688,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07168741869540977,
      "grad_norm": 0.5649752020835876,
      "learning_rate": 9.650632591309431e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.010655809193849564,
      "mae_dx": 0.0014789935667067766,
      "mae_dy": 0.00225039292126894,
      "pose_mae_dtheta": 0.0772101879119873,
      "pose_mae_dx": 0.02102164924144745,
      "pose_mae_dy": 0.02986561320722103,
      "pose_rmse_dtheta": 0.19064584374427795,
      "pose_rmse_dx": 0.05493801459670067,
      "pose_rmse_dy": 0.07724305987358093,
      "pose_rmse_mean": 0.10760897397994995,
      "rmse_dtheta": 0.022603129968047142,
      "rmse_dx": 0.004699484910815954,
      "rmse_dy": 0.004702588077634573,
      "rmse_mean": 0.010668400675058365,
      "rotation_flip": 0.005421184469014406,
      "sparse_tokens": 32089.0,
      "step": 1543,
      "turn_loss": 0.07275325804948807,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31467.0,
      "epoch": 0.07173387846125255,
      "grad_norm": 0.6019240021705627,
      "learning_rate": 9.650146857954814e-06,
      "loss": 0.2025,
      "mae_dtheta": 0.03304383158683777,
      "mae_dx": 0.013139612972736359,
      "mae_dy": 0.0031557343900203705,
      "pose_mae_dtheta": 0.25412771105766296,
      "pose_mae_dx": 0.10944641381502151,
      "pose_mae_dy": 0.03179216384887695,
      "pose_rmse_dtheta": 0.4451510012149811,
      "pose_rmse_dx": 0.2286231964826584,
      "pose_rmse_dy": 0.07057549804449081,
      "pose_rmse_mean": 0.24811655282974243,
      "rmse_dtheta": 0.05062994360923767,
      "rmse_dx": 0.02475854754447937,
      "rmse_dy": 0.00615277886390686,
      "rmse_mean": 0.027180423960089684,
      "rotation_flip": 0.012295082211494446,
      "sparse_tokens": 26011.0,
      "step": 1544,
      "turn_loss": 0.25400620698928833,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07178033822709534,
      "grad_norm": 0.6388687491416931,
      "learning_rate": 9.649660799412934e-06,
      "loss": 0.0956,
      "mae_dtheta": 0.008753404952585697,
      "mae_dx": 0.0017583940643817186,
      "mae_dy": 0.0008719426114112139,
      "pose_mae_dtheta": 0.06118448078632355,
      "pose_mae_dx": 0.017937034368515015,
      "pose_mae_dy": 0.014656099490821362,
      "pose_rmse_dtheta": 0.21411903202533722,
      "pose_rmse_dx": 0.04885784164071083,
      "pose_rmse_dy": 0.039250683039426804,
      "pose_rmse_mean": 0.10074251890182495,
      "rmse_dtheta": 0.02664821967482567,
      "rmse_dx": 0.005688180681318045,
      "rmse_dy": 0.002018947387114167,
      "rmse_mean": 0.011451782658696175,
      "rotation_flip": 0.0006138735334388912,
      "sparse_tokens": 32121.0,
      "step": 1545,
      "turn_loss": 0.05534602329134941,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.07182679799293812,
      "grad_norm": 0.45258551836013794,
      "learning_rate": 9.649174415717776e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.010912240482866764,
      "mae_dx": 0.0023285404313355684,
      "mae_dy": 0.002018655650317669,
      "pose_mae_dtheta": 0.08071926981210709,
      "pose_mae_dx": 0.026225127279758453,
      "pose_mae_dy": 0.03150675818324089,
      "pose_rmse_dtheta": 0.19168579578399658,
      "pose_rmse_dx": 0.0756935402750969,
      "pose_rmse_dy": 0.07469913363456726,
      "pose_rmse_mean": 0.11402615904808044,
      "rmse_dtheta": 0.022802846506237984,
      "rmse_dx": 0.007662078365683556,
      "rmse_dy": 0.004356347024440765,
      "rmse_mean": 0.011607090942561626,
      "rotation_flip": 0.003727369476109743,
      "sparse_tokens": 32057.0,
      "step": 1546,
      "turn_loss": 0.08733703196048737,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.0718732577587809,
      "grad_norm": 0.6199559569358826,
      "learning_rate": 9.648687706903356e-06,
      "loss": 0.1716,
      "mae_dtheta": 0.047577910125255585,
      "mae_dx": 0.019320685416460037,
      "mae_dy": 0.005880007985979319,
      "pose_mae_dtheta": 0.38381096720695496,
      "pose_mae_dx": 0.1374264657497406,
      "pose_mae_dy": 0.0884968712925911,
      "pose_rmse_dtheta": 0.64853835105896,
      "pose_rmse_dx": 0.27489450573921204,
      "pose_rmse_dy": 0.22105662524700165,
      "pose_rmse_mean": 0.38149648904800415,
      "rmse_dtheta": 0.06672398746013641,
      "rmse_dx": 0.033744726330041885,
      "rmse_dy": 0.011114178225398064,
      "rmse_mean": 0.03719429671764374,
      "rotation_flip": 0.019073570147156715,
      "sparse_tokens": 6361.0,
      "step": 1547,
      "turn_loss": 0.4093233048915863,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.07191971752462367,
      "grad_norm": 0.590363621711731,
      "learning_rate": 9.64820067300371e-06,
      "loss": 0.1751,
      "mae_dtheta": 0.009785519912838936,
      "mae_dx": 0.0022268807515501976,
      "mae_dy": 0.0020503944251686335,
      "pose_mae_dtheta": 0.06955372542142868,
      "pose_mae_dx": 0.024350754916667938,
      "pose_mae_dy": 0.027224378660321236,
      "pose_rmse_dtheta": 0.18223203718662262,
      "pose_rmse_dx": 0.059791360050439835,
      "pose_rmse_dy": 0.07433294504880905,
      "pose_rmse_mean": 0.10545211285352707,
      "rmse_dtheta": 0.02138676680624485,
      "rmse_dx": 0.006342177279293537,
      "rmse_dy": 0.004619407933205366,
      "rmse_mean": 0.010782784782350063,
      "rotation_flip": 0.001990445889532566,
      "sparse_tokens": 32137.0,
      "step": 1548,
      "turn_loss": 0.09179558604955673,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.07196617729046646,
      "grad_norm": 0.8644264340400696,
      "learning_rate": 9.647713314052896e-06,
      "loss": 0.2242,
      "mae_dtheta": 0.03520246967673302,
      "mae_dx": 0.013164214789867401,
      "mae_dy": 0.005738832056522369,
      "pose_mae_dtheta": 0.28004446625709534,
      "pose_mae_dx": 0.10485697537660599,
      "pose_mae_dy": 0.046786971390247345,
      "pose_rmse_dtheta": 0.4632221758365631,
      "pose_rmse_dx": 0.21978628635406494,
      "pose_rmse_dy": 0.10715267807245255,
      "pose_rmse_mean": 0.2633870542049408,
      "rmse_dtheta": 0.05224097892642021,
      "rmse_dx": 0.024913789704442024,
      "rmse_dy": 0.010863699950277805,
      "rmse_mean": 0.029339490458369255,
      "rotation_flip": 0.011627906933426857,
      "sparse_tokens": 12319.0,
      "step": 1549,
      "turn_loss": 0.3159772753715515,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.07201263705630924,
      "grad_norm": 0.5507088899612427,
      "learning_rate": 9.647225630084995e-06,
      "loss": 0.0968,
      "mae_dtheta": 0.010161103680729866,
      "mae_dx": 0.001726614311337471,
      "mae_dy": 0.002356959041208029,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5507088899612427,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.40640258789062,
      "model/head/act_norm_mean": 114.84142203282828,
      "model/head/act_norm_min": 53.547340393066406,
      "model/head/act_over_embed": 78.92010038329212,
      "model/head/grad_frac": 0.09505032747983932,
      "model/head/grad_norm": 0.05234505981206894,
      "model/head/grad_zero_frac": 0.00016180859529413283,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6886146622474747,
      "model/head/update_ratio": 0.0009101524483412504,
      "model/head/weight_delta": 4.448181629180908,
      "model/head/weight_delta_rel": 0.07803428173065186,
      "model/head/weight_norm": 57.51240921020508,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41312527656555176,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4130479311613443,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41297513246536255,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28385040530973316,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08262243866920471,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04550091177225113,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5318620391705069,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014808063860982656,
      "model/modality_embedder.encoders.pose/weight_delta": 1.4265342950820923,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.04660931974649429,
      "model/modality_embedder.encoders.pose/weight_norm": 30.72711753845215,
      "model/modality_embedder/grad_frac": 0.08262243866920471,
      "model/modality_embedder/grad_norm": 0.04550091177225113,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5318620391705069,
      "model/modality_embedder/update_ratio": 0.0014808063860982656,
      "model/modality_embedder/weight_delta": 1.4265342950820923,
      "model/modality_embedder/weight_delta_rel": 0.04660931974649429,
      "model/modality_embedder/weight_norm": 30.72711753845215,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.89171600341797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.809646564854898,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.9456205368042,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.362212028791422,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07209067791700363,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03970097750425339,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014402022352442145,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.8154016733169556,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.02971372939646244,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.566251754760742,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.539306640625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.88039872935706,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.414371490478516,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.09804294077701,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07750073820352554,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.042680345475673676,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014668646035715938,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.0070604085922241,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.034885358065366745,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.096309661865234,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.25511169433594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.82531916386083,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.535870552062988,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.43461047199999,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09761353582143784,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05375664308667183,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017903778934851289,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.0661430358886719,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.03579908609390259,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.025304794311523,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.00981140136719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.68083613916947,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.441027641296387,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.709739109055707,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1217275857925415,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0670364648103714,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 9.582795610185713e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002277177292853594,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.9091309309005737,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.031069781631231308,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.438404083251953,
      "model/normalizer/grad_frac": 0.43966037034988403,
      "model/normalizer/grad_norm": 0.24212487041950226,
      "model/normalizer/grad_zero_frac": 0.0001394451392116025,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003108171047642827,
      "model/normalizer/weight_delta": 1.9551721811294556,
      "model/normalizer/weight_delta_rel": 0.0251814853399992,
      "model/normalizer/weight_norm": 77.89946746826172,
      "pose_mae_dtheta": 0.07445812225341797,
      "pose_mae_dx": 0.023705141618847847,
      "pose_mae_dy": 0.03082479164004326,
      "pose_rmse_dtheta": 0.19673343002796173,
      "pose_rmse_dx": 0.0753241628408432,
      "pose_rmse_dy": 0.0743749737739563,
      "pose_rmse_mean": 0.11547752469778061,
      "rmse_dtheta": 0.022756312042474747,
      "rmse_dx": 0.006311706732958555,
      "rmse_dy": 0.005573885980993509,
      "rmse_mean": 0.011547302827239037,
      "rotation_flip": 0.0055962116457521915,
      "sparse_tokens": 32057.0,
      "step": 1550,
      "turn_loss": 0.08264557272195816,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.07205909682215202,
      "grad_norm": 1.026016116142273,
      "learning_rate": 9.646737621134112e-06,
      "loss": 0.1608,
      "mae_dtheta": 0.03175844997167587,
      "mae_dx": 0.01004039216786623,
      "mae_dy": 0.005437382031232119,
      "pose_mae_dtheta": 0.23649434745311737,
      "pose_mae_dx": 0.08187664300203323,
      "pose_mae_dy": 0.06338131427764893,
      "pose_rmse_dtheta": 0.44863805174827576,
      "pose_rmse_dx": 0.19730104506015778,
      "pose_rmse_dy": 0.14284725487232208,
      "pose_rmse_mean": 0.2629287838935852,
      "rmse_dtheta": 0.050297368317842484,
      "rmse_dx": 0.022656282410025597,
      "rmse_dy": 0.010172820650041103,
      "rmse_mean": 0.02770882472395897,
      "rotation_flip": 0.01760268211364746,
      "sparse_tokens": 22921.0,
      "step": 1551,
      "turn_loss": 0.24724511802196503,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.07210555658799479,
      "grad_norm": 0.7256185412406921,
      "learning_rate": 9.646249287234375e-06,
      "loss": 0.2207,
      "mae_dtheta": 0.010143662802875042,
      "mae_dx": 0.0025941343046724796,
      "mae_dy": 0.0020621034782379866,
      "pose_mae_dtheta": 0.07142119854688644,
      "pose_mae_dx": 0.025520378723740578,
      "pose_mae_dy": 0.0233494620770216,
      "pose_rmse_dtheta": 0.19625967741012573,
      "pose_rmse_dx": 0.07199377566576004,
      "pose_rmse_dy": 0.0700833797454834,
      "pose_rmse_mean": 0.11277894675731659,
      "rmse_dtheta": 0.025116104632616043,
      "rmse_dx": 0.008196059614419937,
      "rmse_dy": 0.006421147845685482,
      "rmse_mean": 0.013244437985122204,
      "rotation_flip": 0.0033653846476227045,
      "sparse_tokens": 32153.0,
      "step": 1552,
      "turn_loss": 0.10874327272176743,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.07215201635383757,
      "grad_norm": 0.9728206396102905,
      "learning_rate": 9.64576062841993e-06,
      "loss": 0.2236,
      "mae_dtheta": 0.038292296230793,
      "mae_dx": 0.0117082130163908,
      "mae_dy": 0.013938533142209053,
      "pose_mae_dtheta": 0.31287476420402527,
      "pose_mae_dx": 0.10753524303436279,
      "pose_mae_dy": 0.15853728353977203,
      "pose_rmse_dtheta": 0.5026625990867615,
      "pose_rmse_dx": 0.20845958590507507,
      "pose_rmse_dy": 0.27809739112854004,
      "pose_rmse_mean": 0.32973986864089966,
      "rmse_dtheta": 0.05543312802910805,
      "rmse_dx": 0.02333097718656063,
      "rmse_dy": 0.02397117018699646,
      "rmse_mean": 0.034245092421770096,
      "rotation_flip": 0.01569186896085739,
      "sparse_tokens": 12078.0,
      "step": 1553,
      "turn_loss": 0.41866761445999146,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.07219847611968036,
      "grad_norm": 0.6337117552757263,
      "learning_rate": 9.64527164472495e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.015731146559119225,
      "mae_dx": 0.0037680137902498245,
      "mae_dy": 0.004239601548761129,
      "pose_mae_dtheta": 0.12116798758506775,
      "pose_mae_dx": 0.04234480485320091,
      "pose_mae_dy": 0.05510183796286583,
      "pose_rmse_dtheta": 0.2643558084964752,
      "pose_rmse_dx": 0.11916489154100418,
      "pose_rmse_dy": 0.15487296879291534,
      "pose_rmse_mean": 0.17946456372737885,
      "rmse_dtheta": 0.03002023696899414,
      "rmse_dx": 0.0116037018597126,
      "rmse_dy": 0.011358462274074554,
      "rmse_mean": 0.017660800367593765,
      "rotation_flip": 0.005104043986648321,
      "sparse_tokens": 32057.0,
      "step": 1554,
      "turn_loss": 0.1586150974035263,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36551.0,
      "epoch": 0.07224493588552314,
      "grad_norm": 0.46826377511024475,
      "learning_rate": 9.64478233618363e-06,
      "loss": 0.1239,
      "mae_dtheta": 0.03861283138394356,
      "mae_dx": 0.011556586250662804,
      "mae_dy": 0.006778889801353216,
      "pose_mae_dtheta": 0.3121812045574188,
      "pose_mae_dx": 0.0944933220744133,
      "pose_mae_dy": 0.07400697469711304,
      "pose_rmse_dtheta": 0.5413611531257629,
      "pose_rmse_dx": 0.2044270783662796,
      "pose_rmse_dy": 0.175424262881279,
      "pose_rmse_mean": 0.30707085132598877,
      "rmse_dtheta": 0.05784258618950844,
      "rmse_dx": 0.023313302546739578,
      "rmse_dy": 0.014823950827121735,
      "rmse_mean": 0.031993281096220016,
      "rotation_flip": 0.017212659120559692,
      "sparse_tokens": 28554.0,
      "step": 1555,
      "turn_loss": 0.3002375066280365,
      "turns": 113.0,
      "turns_per_sample": 113.0
    },
    {
      "dense_tokens": 27902.0,
      "epoch": 0.07229139565136591,
      "grad_norm": 0.6663195490837097,
      "learning_rate": 9.644292702830189e-06,
      "loss": 0.1793,
      "mae_dtheta": 0.03357507288455963,
      "mae_dx": 0.010450407862663269,
      "mae_dy": 0.0061399731785058975,
      "pose_mae_dtheta": 0.24865761399269104,
      "pose_mae_dx": 0.09154444187879562,
      "pose_mae_dy": 0.08057018369436264,
      "pose_rmse_dtheta": 0.4397967457771301,
      "pose_rmse_dx": 0.21129406988620758,
      "pose_rmse_dy": 0.1659054309129715,
      "pose_rmse_mean": 0.2723320722579956,
      "rmse_dtheta": 0.049777548760175705,
      "rmse_dx": 0.02312242053449154,
      "rmse_dy": 0.010614214465022087,
      "rmse_mean": 0.02783806249499321,
      "rotation_flip": 0.01702442578971386,
      "sparse_tokens": 22123.0,
      "step": 1556,
      "turn_loss": 0.3028877079486847,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.07233785541720869,
      "grad_norm": 0.6624625325202942,
      "learning_rate": 9.643802744698866e-06,
      "loss": 0.1324,
      "mae_dtheta": 0.04407602548599243,
      "mae_dx": 0.016468599438667297,
      "mae_dy": 0.0036926306784152985,
      "pose_mae_dtheta": 0.375850647687912,
      "pose_mae_dx": 0.13936074078083038,
      "pose_mae_dy": 0.039237868040800095,
      "pose_rmse_dtheta": 0.6259416341781616,
      "pose_rmse_dx": 0.29743948578834534,
      "pose_rmse_dy": 0.09869241714477539,
      "pose_rmse_mean": 0.3406911790370941,
      "rmse_dtheta": 0.06307060271501541,
      "rmse_dx": 0.030587442219257355,
      "rmse_dy": 0.007593182846903801,
      "rmse_mean": 0.03375041112303734,
      "rotation_flip": 0.015384615398943424,
      "sparse_tokens": 11940.0,
      "step": 1557,
      "turn_loss": 0.3544257879257202,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07238431518305148,
      "grad_norm": 0.6704788208007812,
      "learning_rate": 9.643312461823926e-06,
      "loss": 0.146,
      "mae_dtheta": 0.01082590688019991,
      "mae_dx": 0.003606286831200123,
      "mae_dy": 0.0024257716722786427,
      "pose_mae_dtheta": 0.07595521956682205,
      "pose_mae_dx": 0.034624818712472916,
      "pose_mae_dy": 0.031520940363407135,
      "pose_rmse_dtheta": 0.17981600761413574,
      "pose_rmse_dx": 0.08717955648899078,
      "pose_rmse_dy": 0.08062412589788437,
      "pose_rmse_mean": 0.11587323248386383,
      "rmse_dtheta": 0.023098250851035118,
      "rmse_dx": 0.010394889861345291,
      "rmse_dy": 0.00585529301315546,
      "rmse_mean": 0.013116143643856049,
      "rotation_flip": 0.003085059579461813,
      "sparse_tokens": 32105.0,
      "step": 1558,
      "turn_loss": 0.10847809165716171,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.07243077494889426,
      "grad_norm": 0.42784011363983154,
      "learning_rate": 9.642821854239652e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.026706986129283905,
      "mae_dx": 0.008550794795155525,
      "mae_dy": 0.0033576127607375383,
      "pose_mae_dtheta": 0.2129981815814972,
      "pose_mae_dx": 0.06753294914960861,
      "pose_mae_dy": 0.042747531086206436,
      "pose_rmse_dtheta": 0.3323935270309448,
      "pose_rmse_dx": 0.14704692363739014,
      "pose_rmse_dy": 0.11357023566961288,
      "pose_rmse_mean": 0.19767022132873535,
      "rmse_dtheta": 0.03991716355085373,
      "rmse_dx": 0.018533257767558098,
      "rmse_dy": 0.006783090997487307,
      "rmse_mean": 0.021744504570961,
      "rotation_flip": 0.005571030545979738,
      "sparse_tokens": 6348.0,
      "step": 1559,
      "turn_loss": 0.16972970962524414,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.07247723471473703,
      "grad_norm": 0.7618885040283203,
      "learning_rate": 9.642330921980353e-06,
      "loss": 0.1845,
      "mae_dtheta": 0.025726797059178352,
      "mae_dx": 0.010600929148495197,
      "mae_dy": 0.003164358204230666,
      "pose_mae_dtheta": 0.16501954197883606,
      "pose_mae_dx": 0.06782855093479156,
      "pose_mae_dy": 0.030993131920695305,
      "pose_rmse_dtheta": 0.32071155309677124,
      "pose_rmse_dx": 0.16745133697986603,
      "pose_rmse_dy": 0.07367994636297226,
      "pose_rmse_mean": 0.18728093802928925,
      "rmse_dtheta": 0.041841838508844376,
      "rmse_dx": 0.021561818197369576,
      "rmse_dy": 0.006510640028864145,
      "rmse_mean": 0.023304766044020653,
      "rotation_flip": 0.010526316240429878,
      "sparse_tokens": 7089.0,
      "step": 1560,
      "turn_loss": 0.1964980661869049,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.07252369448057981,
      "grad_norm": 0.4884021282196045,
      "learning_rate": 9.641839665080363e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.010005120187997818,
      "mae_dx": 0.0020955067593604326,
      "mae_dy": 0.0019915278535336256,
      "pose_mae_dtheta": 0.07183362543582916,
      "pose_mae_dx": 0.02827017568051815,
      "pose_mae_dy": 0.02736084908246994,
      "pose_rmse_dtheta": 0.15652622282505035,
      "pose_rmse_dx": 0.06010310351848602,
      "pose_rmse_dy": 0.06705085188150406,
      "pose_rmse_mean": 0.09456005692481995,
      "rmse_dtheta": 0.021043553948402405,
      "rmse_dx": 0.00545950373634696,
      "rmse_dy": 0.004229756537824869,
      "rmse_mean": 0.010244271717965603,
      "rotation_flip": 0.0046635577455163,
      "sparse_tokens": 32217.0,
      "step": 1561,
      "turn_loss": 0.07528609782457352,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.0725701542464226,
      "grad_norm": 0.6385617256164551,
      "learning_rate": 9.641348083574034e-06,
      "loss": 0.1806,
      "mae_dtheta": 0.03875141590833664,
      "mae_dx": 0.012521482072770596,
      "mae_dy": 0.008196729235351086,
      "pose_mae_dtheta": 0.29801684617996216,
      "pose_mae_dx": 0.09937083721160889,
      "pose_mae_dy": 0.13342274725437164,
      "pose_rmse_dtheta": 0.4671911597251892,
      "pose_rmse_dx": 0.21812312304973602,
      "pose_rmse_dy": 0.30067574977874756,
      "pose_rmse_mean": 0.32866334915161133,
      "rmse_dtheta": 0.054331909865140915,
      "rmse_dx": 0.025844480842351913,
      "rmse_dy": 0.01749788038432598,
      "rmse_mean": 0.03255809098482132,
      "rotation_flip": 0.0160857904702425,
      "sparse_tokens": 12636.0,
      "step": 1562,
      "turn_loss": 0.2984664738178253,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 42058.0,
      "epoch": 0.07261661401226538,
      "grad_norm": 0.7012810111045837,
      "learning_rate": 9.640856177495741e-06,
      "loss": 0.1924,
      "mae_dtheta": 0.03512522950768471,
      "mae_dx": 0.015286475419998169,
      "mae_dy": 0.005747572518885136,
      "pose_mae_dtheta": 0.2736281752586365,
      "pose_mae_dx": 0.11779173463582993,
      "pose_mae_dy": 0.05913959816098213,
      "pose_rmse_dtheta": 0.46447351574897766,
      "pose_rmse_dx": 0.24871504306793213,
      "pose_rmse_dy": 0.1296595335006714,
      "pose_rmse_mean": 0.28094935417175293,
      "rmse_dtheta": 0.051418717950582504,
      "rmse_dx": 0.0279800146818161,
      "rmse_dy": 0.011241765692830086,
      "rmse_mean": 0.030213501304388046,
      "rotation_flip": 0.01523109246045351,
      "sparse_tokens": 30058.0,
      "step": 1563,
      "turn_loss": 0.30602359771728516,
      "turns": 130.0,
      "turns_per_sample": 130.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.07266307377810816,
      "grad_norm": 0.3877681493759155,
      "learning_rate": 9.640363946879885e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.008249813690781593,
      "mae_dx": 0.001953583676367998,
      "mae_dy": 0.00035048811696469784,
      "pose_mae_dtheta": 0.05939950793981552,
      "pose_mae_dx": 0.01598076894879341,
      "pose_mae_dy": 0.003960051573812962,
      "pose_rmse_dtheta": 0.2229304015636444,
      "pose_rmse_dx": 0.0348476767539978,
      "pose_rmse_dy": 0.008361843414604664,
      "pose_rmse_mean": 0.08871331065893173,
      "rmse_dtheta": 0.02759949304163456,
      "rmse_dx": 0.0049574123695492744,
      "rmse_dy": 0.0007014215225353837,
      "rmse_mean": 0.011086109094321728,
      "rotation_flip": 0.0005068423924967647,
      "sparse_tokens": 32265.0,
      "step": 1564,
      "turn_loss": 0.06626348942518234,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07270953354395093,
      "grad_norm": 0.3513280749320984,
      "learning_rate": 9.639871391760888e-06,
      "loss": 0.1136,
      "mae_dtheta": 0.01229008100926876,
      "mae_dx": 0.002326143207028508,
      "mae_dy": 0.0030098380520939827,
      "pose_mae_dtheta": 0.08640030026435852,
      "pose_mae_dx": 0.03019879199564457,
      "pose_mae_dy": 0.03982124477624893,
      "pose_rmse_dtheta": 0.17414529621601105,
      "pose_rmse_dx": 0.07562852650880814,
      "pose_rmse_dy": 0.09966003894805908,
      "pose_rmse_mean": 0.11647795885801315,
      "rmse_dtheta": 0.02307097800076008,
      "rmse_dx": 0.00674118148162961,
      "rmse_dy": 0.006838763132691383,
      "rmse_mean": 0.012216974049806595,
      "rotation_flip": 0.002850162796676159,
      "sparse_tokens": 32073.0,
      "step": 1565,
      "turn_loss": 0.09933777153491974,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07275599330979372,
      "grad_norm": 0.4471789300441742,
      "learning_rate": 9.639378512173194e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.011323046870529652,
      "mae_dx": 0.0020850577857345343,
      "mae_dy": 0.0021269528660923243,
      "pose_mae_dtheta": 0.0735185444355011,
      "pose_mae_dx": 0.021675126627087593,
      "pose_mae_dy": 0.024103496223688126,
      "pose_rmse_dtheta": 0.18789128959178925,
      "pose_rmse_dx": 0.05264366790652275,
      "pose_rmse_dy": 0.054751742631196976,
      "pose_rmse_mean": 0.09842890501022339,
      "rmse_dtheta": 0.024873316287994385,
      "rmse_dx": 0.006452825851738453,
      "rmse_dy": 0.004571846220642328,
      "rmse_mean": 0.011965996585786343,
      "rotation_flip": 0.008067473769187927,
      "sparse_tokens": 32121.0,
      "step": 1566,
      "turn_loss": 0.08498921990394592,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.0728024530756365,
      "grad_norm": 0.5282798409461975,
      "learning_rate": 9.63888530815127e-06,
      "loss": 0.1577,
      "mae_dtheta": 0.031109364703297615,
      "mae_dx": 0.012820127420127392,
      "mae_dy": 0.008387639187276363,
      "pose_mae_dtheta": 0.2283642292022705,
      "pose_mae_dx": 0.10287295281887054,
      "pose_mae_dy": 0.08182055503129959,
      "pose_rmse_dtheta": 0.4236626923084259,
      "pose_rmse_dx": 0.24330897629261017,
      "pose_rmse_dy": 0.22403140366077423,
      "pose_rmse_mean": 0.29700103402137756,
      "rmse_dtheta": 0.05143420398235321,
      "rmse_dx": 0.0263618566095829,
      "rmse_dy": 0.019192541018128395,
      "rmse_mean": 0.032329533249139786,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 12068.0,
      "step": 1567,
      "turn_loss": 0.2958889901638031,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.07284891284147928,
      "grad_norm": 0.6775311231613159,
      "learning_rate": 9.638391779729606e-06,
      "loss": 0.1628,
      "mae_dtheta": 0.02841513603925705,
      "mae_dx": 0.009741946123540401,
      "mae_dy": 0.0037573915906250477,
      "pose_mae_dtheta": 0.21175044775009155,
      "pose_mae_dx": 0.07925502210855484,
      "pose_mae_dy": 0.04923074692487717,
      "pose_rmse_dtheta": 0.4131680428981781,
      "pose_rmse_dx": 0.18121160566806793,
      "pose_rmse_dy": 0.11354905366897583,
      "pose_rmse_mean": 0.23597624897956848,
      "rmse_dtheta": 0.04712424799799919,
      "rmse_dx": 0.020879989489912987,
      "rmse_dy": 0.007169751916080713,
      "rmse_mean": 0.025057997554540634,
      "rotation_flip": 0.01604278013110161,
      "sparse_tokens": 15948.0,
      "step": 1568,
      "turn_loss": 0.2017185240983963,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07289537260732205,
      "grad_norm": 0.5254542231559753,
      "learning_rate": 9.637897926942716e-06,
      "loss": 0.1366,
      "mae_dtheta": 0.013168423436582088,
      "mae_dx": 0.0028608848806470633,
      "mae_dy": 0.002001639688387513,
      "pose_mae_dtheta": 0.09658703953027725,
      "pose_mae_dx": 0.028195859864354134,
      "pose_mae_dy": 0.028123093768954277,
      "pose_rmse_dtheta": 0.2549636662006378,
      "pose_rmse_dx": 0.07605355978012085,
      "pose_rmse_dy": 0.06727872788906097,
      "pose_rmse_mean": 0.13276532292366028,
      "rmse_dtheta": 0.030378080904483795,
      "rmse_dx": 0.008034338243305683,
      "rmse_dy": 0.005547733511775732,
      "rmse_mean": 0.014653383754193783,
      "rotation_flip": 0.0038759689778089523,
      "sparse_tokens": 32121.0,
      "step": 1569,
      "turn_loss": 0.10851942747831345,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.07294183237316484,
      "grad_norm": 0.5961431860923767,
      "learning_rate": 9.637403749825136e-06,
      "loss": 0.1852,
      "mae_dtheta": 0.012122581712901592,
      "mae_dx": 0.002669526496902108,
      "mae_dy": 0.0031037551816552877,
      "pose_mae_dtheta": 0.08330866694450378,
      "pose_mae_dx": 0.031427785754203796,
      "pose_mae_dy": 0.035876523703336716,
      "pose_rmse_dtheta": 0.1651725471019745,
      "pose_rmse_dx": 0.07321469485759735,
      "pose_rmse_dy": 0.08727509528398514,
      "pose_rmse_mean": 0.10855411738157272,
      "rmse_dtheta": 0.022357184439897537,
      "rmse_dx": 0.007372914347797632,
      "rmse_dy": 0.0065648420713841915,
      "rmse_mean": 0.012098314240574837,
      "rotation_flip": 0.003843690035864711,
      "sparse_tokens": 32153.0,
      "step": 1570,
      "turn_loss": 0.10622257739305496,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.07298829213900762,
      "grad_norm": 0.4815717339515686,
      "learning_rate": 9.636909248411421e-06,
      "loss": 0.0952,
      "mae_dtheta": 0.03439782187342644,
      "mae_dx": 0.007763032801449299,
      "mae_dy": 0.0024705901741981506,
      "pose_mae_dtheta": 0.24779082834720612,
      "pose_mae_dx": 0.06069166585803032,
      "pose_mae_dy": 0.03469220548868179,
      "pose_rmse_dtheta": 0.4605215787887573,
      "pose_rmse_dx": 0.16055621206760406,
      "pose_rmse_dy": 0.08087652921676636,
      "pose_rmse_mean": 0.23398476839065552,
      "rmse_dtheta": 0.05176350474357605,
      "rmse_dx": 0.018877249211072922,
      "rmse_dy": 0.005203651264309883,
      "rmse_mean": 0.025281470268964767,
      "rotation_flip": 0.014409221708774567,
      "sparse_tokens": 6227.0,
      "step": 1571,
      "turn_loss": 0.2962523400783539,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 33088.0,
      "epoch": 0.0730347519048504,
      "grad_norm": 0.5890660285949707,
      "learning_rate": 9.636414422736153e-06,
      "loss": 0.182,
      "mae_dtheta": 0.03336590901017189,
      "mae_dx": 0.011347606778144836,
      "mae_dy": 0.005266414023935795,
      "pose_mae_dtheta": 0.25180041790008545,
      "pose_mae_dx": 0.09435495734214783,
      "pose_mae_dy": 0.05272477865219116,
      "pose_rmse_dtheta": 0.4440182149410248,
      "pose_rmse_dx": 0.21443448960781097,
      "pose_rmse_dy": 0.17638614773750305,
      "pose_rmse_mean": 0.2782796323299408,
      "rmse_dtheta": 0.051619697362184525,
      "rmse_dx": 0.023379558697342873,
      "rmse_dy": 0.01305958442389965,
      "rmse_mean": 0.02935294806957245,
      "rotation_flip": 0.00995316170156002,
      "sparse_tokens": 25746.0,
      "step": 1572,
      "turn_loss": 0.2984338402748108,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07308121167069317,
      "grad_norm": 0.4048582911491394,
      "learning_rate": 9.635919272833938e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.010896621271967888,
      "mae_dx": 0.002793225459754467,
      "mae_dy": 0.002776855370029807,
      "pose_mae_dtheta": 0.0752263218164444,
      "pose_mae_dx": 0.03280634060502052,
      "pose_mae_dy": 0.03699002042412758,
      "pose_rmse_dtheta": 0.16266991198062897,
      "pose_rmse_dx": 0.09190335869789124,
      "pose_rmse_dy": 0.094804547727108,
      "pose_rmse_mean": 0.11645928025245667,
      "rmse_dtheta": 0.02249518595635891,
      "rmse_dx": 0.009167701937258244,
      "rmse_dy": 0.0061394465155899525,
      "rmse_mean": 0.012600778602063656,
      "rotation_flip": 0.004123711492866278,
      "sparse_tokens": 32089.0,
      "step": 1573,
      "turn_loss": 0.11611019819974899,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07312767143653597,
      "grad_norm": 0.40615177154541016,
      "learning_rate": 9.635423798739398e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.012208763509988785,
      "mae_dx": 0.0021102773025631905,
      "mae_dy": 0.0036420999094843864,
      "pose_mae_dtheta": 0.08469187468290329,
      "pose_mae_dx": 0.03221123665571213,
      "pose_mae_dy": 0.04105842486023903,
      "pose_rmse_dtheta": 0.18316878378391266,
      "pose_rmse_dx": 0.07433654367923737,
      "pose_rmse_dy": 0.11197075247764587,
      "pose_rmse_mean": 0.12315869331359863,
      "rmse_dtheta": 0.023338081315159798,
      "rmse_dx": 0.005780781153589487,
      "rmse_dy": 0.008600658737123013,
      "rmse_mean": 0.012573174200952053,
      "rotation_flip": 0.0021834061481058598,
      "sparse_tokens": 32105.0,
      "step": 1574,
      "turn_loss": 0.1043100655078888,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07317413120237874,
      "grad_norm": 0.4836122393608093,
      "learning_rate": 9.634928000487184e-06,
      "loss": 0.0606,
      "mae_dtheta": 0.010234798304736614,
      "mae_dx": 0.001965276664122939,
      "mae_dy": 0.0012930943630635738,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4836122989654541,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.89761352539062,
      "model/head/act_norm_mean": 125.46437026515152,
      "model/head/act_norm_min": 83.69499206542969,
      "model/head/act_over_embed": 86.22028986215292,
      "model/head/grad_frac": 0.10383210331201553,
      "model/head/grad_norm": 0.050214480608701706,
      "model/head/grad_zero_frac": 0.0001532422611489892,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.678415009469697,
      "model/head/update_ratio": 0.0008729882538318634,
      "model/head/weight_delta": 4.483819484710693,
      "model/head/weight_delta_rel": 0.07865947484970093,
      "model/head/weight_norm": 57.520225524902344,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41330236196517944,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4132373725043403,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4131626486778259,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2839805911742178,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0716465637087822,
      "model/modality_embedder.encoders.pose/grad_norm": 0.034649159759283066,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5231510416666667,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011275880970060825,
      "model/modality_embedder.encoders.pose/weight_delta": 1.4548707008361816,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.047535158693790436,
      "model/modality_embedder.encoders.pose/weight_norm": 30.728561401367188,
      "model/modality_embedder/grad_frac": 0.0716465637087822,
      "model/modality_embedder/grad_norm": 0.034649159759283066,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5231510416666667,
      "model/modality_embedder/update_ratio": 0.0011275880970060825,
      "model/modality_embedder/weight_delta": 1.4548707008361816,
      "model/modality_embedder/weight_delta_rel": 0.047535158693790436,
      "model/modality_embedder/weight_norm": 30.728561401367188,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.38009643554688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.836129148629148,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.764412879943848,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.067620470442446,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08981196582317352,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04343417286872864,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015755572821944952,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.8255853652954102,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.030084829777479172,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.5674991607666,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.68968200683594,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.936615660573995,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.166770935058594,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.823885104367992,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08554334938526154,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04136981442570686,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 9.582795610185713e-05,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014216743875294924,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.0212444067001343,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.03537670522928238,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.0993595123291,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.4138412475586,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.805475388808723,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.050904273986816,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.108183006151336,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08552298694849014,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04135996848344803,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001377306180074811,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.082066535949707,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.03633376955986023,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.02960968017578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.10401153564453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.57378597482764,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.091935157775879,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.323382596048074,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.111305370926857,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0538286454975605,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018284094985574484,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.9211763739585876,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.031481437385082245,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.440147399902344,
      "model/normalizer/grad_frac": 0.39232394099235535,
      "model/normalizer/grad_norm": 0.18973268568515778,
      "model/normalizer/grad_zero_frac": 0.00010753819515230134,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0024355032946914434,
      "model/normalizer/weight_delta": 1.982374668121338,
      "model/normalizer/weight_delta_rel": 0.025531837716698647,
      "model/normalizer/weight_norm": 77.90286254882812,
      "pose_mae_dtheta": 0.07588077336549759,
      "pose_mae_dx": 0.019117487594485283,
      "pose_mae_dy": 0.023028111085295677,
      "pose_rmse_dtheta": 0.2032105028629303,
      "pose_rmse_dx": 0.04546903446316719,
      "pose_rmse_dy": 0.058571841567754745,
      "pose_rmse_mean": 0.10241712629795074,
      "rmse_dtheta": 0.023885095492005348,
      "rmse_dx": 0.005780934356153011,
      "rmse_dy": 0.002726146252825856,
      "rmse_mean": 0.010797391645610332,
      "rotation_flip": 0.0033333334140479565,
      "sparse_tokens": 32121.0,
      "step": 1575,
      "turn_loss": 0.06274387240409851,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07322059096822152,
      "grad_norm": 0.4758285880088806,
      "learning_rate": 9.634431878111969e-06,
      "loss": 0.1121,
      "mae_dtheta": 0.009560317732393742,
      "mae_dx": 0.001547495019622147,
      "mae_dy": 0.0020687738433480263,
      "pose_mae_dtheta": 0.06739147752523422,
      "pose_mae_dx": 0.020721420645713806,
      "pose_mae_dy": 0.02818853221833706,
      "pose_rmse_dtheta": 0.15478956699371338,
      "pose_rmse_dx": 0.050549767911434174,
      "pose_rmse_dy": 0.07951482385396957,
      "pose_rmse_mean": 0.09495139122009277,
      "rmse_dtheta": 0.020367290824651718,
      "rmse_dx": 0.004733623471111059,
      "rmse_dy": 0.004590773023664951,
      "rmse_mean": 0.009897230193018913,
      "rotation_flip": 0.002704791259020567,
      "sparse_tokens": 32121.0,
      "step": 1576,
      "turn_loss": 0.0759599506855011,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1663.0,
      "epoch": 0.0732670507340643,
      "grad_norm": 0.5549758672714233,
      "learning_rate": 9.633935431648444e-06,
      "loss": 0.1448,
      "mae_dtheta": 0.050151996314525604,
      "mae_dx": 0.03246767446398735,
      "mae_dy": 0.021796029061079025,
      "pose_mae_dtheta": 0.18922993540763855,
      "pose_mae_dx": 0.2185487449169159,
      "pose_mae_dy": 0.1817302405834198,
      "pose_rmse_dtheta": 0.23893998563289642,
      "pose_rmse_dx": 0.36419928073883057,
      "pose_rmse_dy": 0.23059405386447906,
      "pose_rmse_mean": 0.27791112661361694,
      "rmse_dtheta": 0.06091389060020447,
      "rmse_dx": 0.045984476804733276,
      "rmse_dy": 0.025857750326395035,
      "rmse_mean": 0.04425203800201416,
      "rotation_flip": 0.0,
      "sparse_tokens": 1539.0,
      "step": 1577,
      "turn_loss": 0.8885445594787598,
      "turns": 5.0,
      "turns_per_sample": 5.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07331351049990709,
      "grad_norm": 0.4043678641319275,
      "learning_rate": 9.633438661131327e-06,
      "loss": 0.0922,
      "mae_dtheta": 0.008662155829370022,
      "mae_dx": 0.0017756408778950572,
      "mae_dy": 0.0016934496816247702,
      "pose_mae_dtheta": 0.05918116495013237,
      "pose_mae_dx": 0.01982356235384941,
      "pose_mae_dy": 0.022493189200758934,
      "pose_rmse_dtheta": 0.1369943767786026,
      "pose_rmse_dx": 0.054779645055532455,
      "pose_rmse_dy": 0.05068030208349228,
      "pose_rmse_mean": 0.08081810921430588,
      "rmse_dtheta": 0.018811000511050224,
      "rmse_dx": 0.006429924163967371,
      "rmse_dy": 0.0035096381325274706,
      "rmse_mean": 0.009583521634340286,
      "rotation_flip": 0.004590984899550676,
      "sparse_tokens": 32089.0,
      "step": 1578,
      "turn_loss": 0.0697946548461914,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.07335997026574986,
      "grad_norm": 0.5602269172668457,
      "learning_rate": 9.632941566595357e-06,
      "loss": 0.1577,
      "mae_dtheta": 0.0249639842659235,
      "mae_dx": 0.011421841569244862,
      "mae_dy": 0.006443228106945753,
      "pose_mae_dtheta": 0.17296531796455383,
      "pose_mae_dx": 0.10006894171237946,
      "pose_mae_dy": 0.07682105898857117,
      "pose_rmse_dtheta": 0.32856255769729614,
      "pose_rmse_dx": 0.19952411949634552,
      "pose_rmse_dy": 0.17258870601654053,
      "pose_rmse_mean": 0.23355846107006073,
      "rmse_dtheta": 0.041284263134002686,
      "rmse_dx": 0.023180551826953888,
      "rmse_dy": 0.01120414026081562,
      "rmse_mean": 0.025222985073924065,
      "rotation_flip": 0.007476635742932558,
      "sparse_tokens": 9569.0,
      "step": 1579,
      "turn_loss": 0.2564922273159027,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07340643003159264,
      "grad_norm": 0.37384307384490967,
      "learning_rate": 9.632444148075298e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.014853688888251781,
      "mae_dx": 0.0026638188865035772,
      "mae_dy": 0.003169277450069785,
      "pose_mae_dtheta": 0.1055775135755539,
      "pose_mae_dx": 0.03058156557381153,
      "pose_mae_dy": 0.03786224126815796,
      "pose_rmse_dtheta": 0.23910653591156006,
      "pose_rmse_dx": 0.07401726394891739,
      "pose_rmse_dy": 0.08458700031042099,
      "pose_rmse_mean": 0.1325702667236328,
      "rmse_dtheta": 0.029395420104265213,
      "rmse_dx": 0.007786280941218138,
      "rmse_dy": 0.007773902732878923,
      "rmse_mean": 0.014985201880335808,
      "rotation_flip": 0.003513703355565667,
      "sparse_tokens": 32121.0,
      "step": 1580,
      "turn_loss": 0.13006123900413513,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.07345288979743542,
      "grad_norm": 0.42371222376823425,
      "learning_rate": 9.631946405605932e-06,
      "loss": 0.1138,
      "mae_dtheta": 0.039675913751125336,
      "mae_dx": 0.02042068913578987,
      "mae_dy": 0.0075011951848864555,
      "pose_mae_dtheta": 0.3242814540863037,
      "pose_mae_dx": 0.17986063659191132,
      "pose_mae_dy": 0.1054111123085022,
      "pose_rmse_dtheta": 0.5004356503486633,
      "pose_rmse_dx": 0.3201659619808197,
      "pose_rmse_dy": 0.2053106129169464,
      "pose_rmse_mean": 0.3419707417488098,
      "rmse_dtheta": 0.05424567684531212,
      "rmse_dx": 0.033992644399404526,
      "rmse_dy": 0.01184888556599617,
      "rmse_mean": 0.03336240351200104,
      "rotation_flip": 0.02185792289674282,
      "sparse_tokens": 5995.0,
      "step": 1581,
      "turn_loss": 0.3729453384876251,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07349934956327821,
      "grad_norm": 0.35086774826049805,
      "learning_rate": 9.631448339222069e-06,
      "loss": 0.1093,
      "mae_dtheta": 0.01016591303050518,
      "mae_dx": 0.0020901516545563936,
      "mae_dy": 0.003107986878603697,
      "pose_mae_dtheta": 0.07004620879888535,
      "pose_mae_dx": 0.024151818826794624,
      "pose_mae_dy": 0.028581151738762856,
      "pose_rmse_dtheta": 0.19318270683288574,
      "pose_rmse_dx": 0.06738193333148956,
      "pose_rmse_dy": 0.07507804036140442,
      "pose_rmse_mean": 0.11188089102506638,
      "rmse_dtheta": 0.02452762797474861,
      "rmse_dx": 0.0072838072665035725,
      "rmse_dy": 0.008442831225693226,
      "rmse_mean": 0.013418088667094707,
      "rotation_flip": 0.003870967775583267,
      "sparse_tokens": 32073.0,
      "step": 1582,
      "turn_loss": 0.09763989597558975,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.07354580932912098,
      "grad_norm": 0.3793383538722992,
      "learning_rate": 9.630949948958536e-06,
      "loss": 0.0942,
      "mae_dtheta": 0.03044639714062214,
      "mae_dx": 0.010503388941287994,
      "mae_dy": 0.005308880005031824,
      "pose_mae_dtheta": 0.22788025438785553,
      "pose_mae_dx": 0.08677481859922409,
      "pose_mae_dy": 0.06716250628232956,
      "pose_rmse_dtheta": 0.4717422425746918,
      "pose_rmse_dx": 0.2268359363079071,
      "pose_rmse_dy": 0.1668672412633896,
      "pose_rmse_mean": 0.28848183155059814,
      "rmse_dtheta": 0.05048255994915962,
      "rmse_dx": 0.024677753448486328,
      "rmse_dy": 0.011548065580427647,
      "rmse_mean": 0.028902791440486908,
      "rotation_flip": 0.010335917584598064,
      "sparse_tokens": 6533.0,
      "step": 1583,
      "turn_loss": 0.18796728551387787,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.07359226909496376,
      "grad_norm": 0.7273414134979248,
      "learning_rate": 9.63045123485019e-06,
      "loss": 0.1975,
      "mae_dtheta": 0.04073348268866539,
      "mae_dx": 0.018796585500240326,
      "mae_dy": 0.014461238868534565,
      "pose_mae_dtheta": 0.29448625445365906,
      "pose_mae_dx": 0.13058343529701233,
      "pose_mae_dy": 0.10517231374979019,
      "pose_rmse_dtheta": 0.469516783952713,
      "pose_rmse_dx": 0.27486807107925415,
      "pose_rmse_dy": 0.24670888483524323,
      "pose_rmse_mean": 0.3303645849227905,
      "rmse_dtheta": 0.059073906391859055,
      "rmse_dx": 0.03096025623381138,
      "rmse_dy": 0.026082221418619156,
      "rmse_mean": 0.03870546445250511,
      "rotation_flip": 0.022364217787981033,
      "sparse_tokens": 5557.0,
      "step": 1584,
      "turn_loss": 0.5428414344787598,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.07363872886080654,
      "grad_norm": 0.4165947437286377,
      "learning_rate": 9.629952196931902e-06,
      "loss": 0.1195,
      "mae_dtheta": 0.01037513092160225,
      "mae_dx": 0.002471023006364703,
      "mae_dy": 0.0015744169941172004,
      "pose_mae_dtheta": 0.06804056465625763,
      "pose_mae_dx": 0.025365158915519714,
      "pose_mae_dy": 0.024100491777062416,
      "pose_rmse_dtheta": 0.1563674956560135,
      "pose_rmse_dx": 0.055279478430747986,
      "pose_rmse_dy": 0.0595395527780056,
      "pose_rmse_mean": 0.09039551019668579,
      "rmse_dtheta": 0.024411344900727272,
      "rmse_dx": 0.0066523305140435696,
      "rmse_dy": 0.003371730912476778,
      "rmse_mean": 0.011478468775749207,
      "rotation_flip": 0.0065822782926261425,
      "sparse_tokens": 32137.0,
      "step": 1585,
      "turn_loss": 0.09563399851322174,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07368518862664933,
      "grad_norm": 0.4317079782485962,
      "learning_rate": 9.629452835238573e-06,
      "loss": 0.129,
      "mae_dtheta": 0.013467097654938698,
      "mae_dx": 0.0020027882419526577,
      "mae_dy": 0.003318553790450096,
      "pose_mae_dtheta": 0.09470327943563461,
      "pose_mae_dx": 0.02953229285776615,
      "pose_mae_dy": 0.044985268265008926,
      "pose_rmse_dtheta": 0.1710781306028366,
      "pose_rmse_dx": 0.0672755092382431,
      "pose_rmse_dy": 0.09952570497989655,
      "pose_rmse_mean": 0.11262645572423935,
      "rmse_dtheta": 0.023961087688803673,
      "rmse_dx": 0.005439503584057093,
      "rmse_dy": 0.006417614873498678,
      "rmse_mean": 0.011939401738345623,
      "rotation_flip": 0.0073152887634932995,
      "sparse_tokens": 32089.0,
      "step": 1586,
      "turn_loss": 0.11970740556716919,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.0737316483924921,
      "grad_norm": 0.680837869644165,
      "learning_rate": 9.628953149805122e-06,
      "loss": 0.2042,
      "mae_dtheta": 0.04331756755709648,
      "mae_dx": 0.016025638207793236,
      "mae_dy": 0.007419442292302847,
      "pose_mae_dtheta": 0.37404608726501465,
      "pose_mae_dx": 0.13799577951431274,
      "pose_mae_dy": 0.07304010540246964,
      "pose_rmse_dtheta": 0.5934724807739258,
      "pose_rmse_dx": 0.26992660760879517,
      "pose_rmse_dy": 0.15927718579769135,
      "pose_rmse_mean": 0.34089207649230957,
      "rmse_dtheta": 0.06097967550158501,
      "rmse_dx": 0.028786100447177887,
      "rmse_dy": 0.015880540013313293,
      "rmse_mean": 0.03521543741226196,
      "rotation_flip": 0.011194029822945595,
      "sparse_tokens": 12664.0,
      "step": 1587,
      "turn_loss": 0.36449041962623596,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07377810815833488,
      "grad_norm": 0.36583492159843445,
      "learning_rate": 9.628453140666491e-06,
      "loss": 0.0819,
      "mae_dtheta": 0.006380319595336914,
      "mae_dx": 0.0017774266889318824,
      "mae_dy": 0.0009252600721083581,
      "pose_mae_dtheta": 0.049084994941949844,
      "pose_mae_dx": 0.017839649692177773,
      "pose_mae_dy": 0.015633415430784225,
      "pose_rmse_dtheta": 0.16872107982635498,
      "pose_rmse_dx": 0.051672425121068954,
      "pose_rmse_dy": 0.04727456718683243,
      "pose_rmse_mean": 0.08922269195318222,
      "rmse_dtheta": 0.01921156421303749,
      "rmse_dx": 0.0062385378405451775,
      "rmse_dy": 0.0022925743833184242,
      "rmse_mean": 0.009247559122741222,
      "rotation_flip": 0.004581151995807886,
      "sparse_tokens": 32121.0,
      "step": 1588,
      "turn_loss": 0.05591026321053505,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07382456792417766,
      "grad_norm": 0.4162899851799011,
      "learning_rate": 9.62795280785765e-06,
      "loss": 0.1356,
      "mae_dtheta": 0.009920070879161358,
      "mae_dx": 0.0016380581073462963,
      "mae_dy": 0.002249647630378604,
      "pose_mae_dtheta": 0.07081881910562515,
      "pose_mae_dx": 0.018567722290754318,
      "pose_mae_dy": 0.028427153825759888,
      "pose_rmse_dtheta": 0.19982346892356873,
      "pose_rmse_dx": 0.052600353956222534,
      "pose_rmse_dy": 0.061519406735897064,
      "pose_rmse_mean": 0.10464774817228317,
      "rmse_dtheta": 0.02274465374648571,
      "rmse_dx": 0.0051064384169876575,
      "rmse_dy": 0.0051618837751448154,
      "rmse_mean": 0.01100432500243187,
      "rotation_flip": 0.010820559225976467,
      "sparse_tokens": 32089.0,
      "step": 1589,
      "turn_loss": 0.07533425092697144,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34606.0,
      "epoch": 0.07387102769002044,
      "grad_norm": 0.5445781350135803,
      "learning_rate": 9.627452151413584e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.03725527226924896,
      "mae_dx": 0.015995148569345474,
      "mae_dy": 0.0055642942897975445,
      "pose_mae_dtheta": 0.28954893350601196,
      "pose_mae_dx": 0.14050287008285522,
      "pose_mae_dy": 0.07315272837877274,
      "pose_rmse_dtheta": 0.4915038049221039,
      "pose_rmse_dx": 0.28458791971206665,
      "pose_rmse_dy": 0.16989710927009583,
      "pose_rmse_mean": 0.3153296113014221,
      "rmse_dtheta": 0.05391182750463486,
      "rmse_dx": 0.0297402311116457,
      "rmse_dy": 0.011482678353786469,
      "rmse_mean": 0.031711578369140625,
      "rotation_flip": 0.012620192021131516,
      "sparse_tokens": 26454.0,
      "step": 1590,
      "turn_loss": 0.26607033610343933,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 35578.0,
      "epoch": 0.07391748745586323,
      "grad_norm": 0.4105463922023773,
      "learning_rate": 9.626951171369306e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.04259752109646797,
      "mae_dx": 0.015607403591275215,
      "mae_dy": 0.006909349001944065,
      "pose_mae_dtheta": 0.36242160201072693,
      "pose_mae_dx": 0.1330638825893402,
      "pose_mae_dy": 0.07625927776098251,
      "pose_rmse_dtheta": 0.5985118746757507,
      "pose_rmse_dx": 0.27666687965393066,
      "pose_rmse_dy": 0.17323389649391174,
      "pose_rmse_mean": 0.34947091341018677,
      "rmse_dtheta": 0.060766205191612244,
      "rmse_dx": 0.028682908043265343,
      "rmse_dy": 0.01473621092736721,
      "rmse_mean": 0.03472844511270523,
      "rotation_flip": 0.018856806680560112,
      "sparse_tokens": 28263.0,
      "step": 1591,
      "turn_loss": 0.31459301710128784,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 42188.0,
      "epoch": 0.073963947221706,
      "grad_norm": 0.521094560623169,
      "learning_rate": 9.626449867759849e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.03457982838153839,
      "mae_dx": 0.013682934455573559,
      "mae_dy": 0.0038659879937767982,
      "pose_mae_dtheta": 0.27087050676345825,
      "pose_mae_dx": 0.09959636628627777,
      "pose_mae_dy": 0.04934680834412575,
      "pose_rmse_dtheta": 0.48911038041114807,
      "pose_rmse_dx": 0.21215441823005676,
      "pose_rmse_dy": 0.12443885207176208,
      "pose_rmse_mean": 0.27523455023765564,
      "rmse_dtheta": 0.05287819728255272,
      "rmse_dx": 0.02596934698522091,
      "rmse_dy": 0.008170893415808678,
      "rmse_mean": 0.029006145894527435,
      "rotation_flip": 0.016024036332964897,
      "sparse_tokens": 30188.0,
      "step": 1592,
      "turn_loss": 0.25480762124061584,
      "turns": 130.0,
      "turns_per_sample": 130.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.07401040698754878,
      "grad_norm": 0.4284149706363678,
      "learning_rate": 9.625948240620268e-06,
      "loss": 0.1352,
      "mae_dtheta": 0.007062106393277645,
      "mae_dx": 0.0015213399892672896,
      "mae_dy": 0.000985242542810738,
      "pose_mae_dtheta": 0.05136151239275932,
      "pose_mae_dx": 0.013497920706868172,
      "pose_mae_dy": 0.0156179741024971,
      "pose_rmse_dtheta": 0.1550266295671463,
      "pose_rmse_dx": 0.032232727855443954,
      "pose_rmse_dy": 0.04507969319820404,
      "pose_rmse_mean": 0.0774463564157486,
      "rmse_dtheta": 0.02071147784590721,
      "rmse_dx": 0.004598048981279135,
      "rmse_dy": 0.002645831787958741,
      "rmse_mean": 0.009318453259766102,
      "rotation_flip": 0.003522898769006133,
      "sparse_tokens": 32153.0,
      "step": 1593,
      "turn_loss": 0.05112084373831749,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30077.0,
      "epoch": 0.07405686675339156,
      "grad_norm": 1.0013513565063477,
      "learning_rate": 9.625446289985646e-06,
      "loss": 0.2877,
      "mae_dtheta": 0.03167487680912018,
      "mae_dx": 0.013001927174627781,
      "mae_dy": 0.005504926200956106,
      "pose_mae_dtheta": 0.2525007128715515,
      "pose_mae_dx": 0.10524670034646988,
      "pose_mae_dy": 0.07246659696102142,
      "pose_rmse_dtheta": 0.42905348539352417,
      "pose_rmse_dx": 0.2275126874446869,
      "pose_rmse_dy": 0.16810822486877441,
      "pose_rmse_mean": 0.2748914659023285,
      "rmse_dtheta": 0.047650329768657684,
      "rmse_dx": 0.025638720020651817,
      "rmse_dy": 0.011020605452358723,
      "rmse_mean": 0.028103221207857132,
      "rotation_flip": 0.01197126880288124,
      "sparse_tokens": 25109.0,
      "step": 1594,
      "turn_loss": 0.2606773376464844,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.07410332651923435,
      "grad_norm": 0.5290542244911194,
      "learning_rate": 9.62494401589108e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.007949764840304852,
      "mae_dx": 0.0021647284738719463,
      "mae_dy": 0.0017844728427007794,
      "pose_mae_dtheta": 0.061400722712278366,
      "pose_mae_dx": 0.022100787609815598,
      "pose_mae_dy": 0.023966172710061073,
      "pose_rmse_dtheta": 0.15899355709552765,
      "pose_rmse_dx": 0.057867396622896194,
      "pose_rmse_dy": 0.07923063635826111,
      "pose_rmse_mean": 0.09869720041751862,
      "rmse_dtheta": 0.019985150545835495,
      "rmse_dx": 0.006295319180935621,
      "rmse_dy": 0.0058681354857981205,
      "rmse_mean": 0.010716202668845654,
      "rotation_flip": 0.002016128972172737,
      "sparse_tokens": 32169.0,
      "step": 1595,
      "turn_loss": 0.07520139217376709,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07414978628507712,
      "grad_norm": 0.5406139492988586,
      "learning_rate": 9.6244414183717e-06,
      "loss": 0.0857,
      "mae_dtheta": 0.012093682773411274,
      "mae_dx": 0.002164248377084732,
      "mae_dy": 0.0031640389934182167,
      "pose_mae_dtheta": 0.09156996011734009,
      "pose_mae_dx": 0.026862261816859245,
      "pose_mae_dy": 0.03539842739701271,
      "pose_rmse_dtheta": 0.24629567563533783,
      "pose_rmse_dx": 0.08070889115333557,
      "pose_rmse_dy": 0.10245437920093536,
      "pose_rmse_mean": 0.14315298199653625,
      "rmse_dtheta": 0.028116554021835327,
      "rmse_dx": 0.006629238370805979,
      "rmse_dy": 0.008603405207395554,
      "rmse_mean": 0.014449733309447765,
      "rotation_flip": 0.005681818351149559,
      "sparse_tokens": 32105.0,
      "step": 1596,
      "turn_loss": 0.11126109957695007,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0741962460509199,
      "grad_norm": 0.668908417224884,
      "learning_rate": 9.623938497462647e-06,
      "loss": 0.1276,
      "mae_dtheta": 0.010519583709537983,
      "mae_dx": 0.001943101640790701,
      "mae_dy": 0.002707479754462838,
      "pose_mae_dtheta": 0.07647979259490967,
      "pose_mae_dx": 0.028476666659116745,
      "pose_mae_dy": 0.03370785713195801,
      "pose_rmse_dtheta": 0.1667364090681076,
      "pose_rmse_dx": 0.06750895082950592,
      "pose_rmse_dy": 0.08669789880514145,
      "pose_rmse_mean": 0.10698109120130539,
      "rmse_dtheta": 0.020505571737885475,
      "rmse_dx": 0.005622213706374168,
      "rmse_dy": 0.005707822740077972,
      "rmse_mean": 0.010611869394779205,
      "rotation_flip": 0.0032051282469183207,
      "sparse_tokens": 32089.0,
      "step": 1597,
      "turn_loss": 0.09076622873544693,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.07424270581676268,
      "grad_norm": 0.41246068477630615,
      "learning_rate": 9.623435253199092e-06,
      "loss": 0.1542,
      "mae_dtheta": 0.038008421659469604,
      "mae_dx": 0.01619100570678711,
      "mae_dy": 0.00475896243005991,
      "pose_mae_dtheta": 0.2965559661388397,
      "pose_mae_dx": 0.1200135350227356,
      "pose_mae_dy": 0.06225849315524101,
      "pose_rmse_dtheta": 0.5342292785644531,
      "pose_rmse_dx": 0.2655971348285675,
      "pose_rmse_dy": 0.15051235258579254,
      "pose_rmse_mean": 0.31677958369255066,
      "rmse_dtheta": 0.05680570378899574,
      "rmse_dx": 0.03013802506029606,
      "rmse_dy": 0.00910589937120676,
      "rmse_mean": 0.03201654553413391,
      "rotation_flip": 0.0071428571827709675,
      "sparse_tokens": 13922.0,
      "step": 1598,
      "turn_loss": 0.28398868441581726,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07428916558260547,
      "grad_norm": 0.45465287566185,
      "learning_rate": 9.62293168561623e-06,
      "loss": 0.0812,
      "mae_dtheta": 0.00860324501991272,
      "mae_dx": 0.001751002506352961,
      "mae_dy": 0.0016126623377203941,
      "pose_mae_dtheta": 0.06329727917909622,
      "pose_mae_dx": 0.02115960791707039,
      "pose_mae_dy": 0.02645326405763626,
      "pose_rmse_dtheta": 0.1491268128156662,
      "pose_rmse_dx": 0.06292764097452164,
      "pose_rmse_dy": 0.06711137294769287,
      "pose_rmse_mean": 0.09305527806282043,
      "rmse_dtheta": 0.019689222797751427,
      "rmse_dx": 0.005739645101130009,
      "rmse_dy": 0.003768039168789983,
      "rmse_mean": 0.009732303209602833,
      "rotation_flip": 0.0010341261513531208,
      "sparse_tokens": 32089.0,
      "step": 1599,
      "turn_loss": 0.06424545496702194,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.07433562534844824,
      "grad_norm": 0.7064546346664429,
      "learning_rate": 9.622427794749275e-06,
      "loss": 0.2064,
      "mae_dtheta": 0.032342731952667236,
      "mae_dx": 0.009836584329605103,
      "mae_dy": 0.0044763460755348206,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7064547538757324,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 146.5961456298828,
      "model/head/act_norm_mean": 105.5677005828373,
      "model/head/act_norm_min": 68.97047424316406,
      "model/head/act_over_embed": 72.5471121809102,
      "model/head/grad_frac": 0.11097773164510727,
      "model/head/grad_norm": 0.07840074598789215,
      "model/head/grad_zero_frac": 0.00018338309018872678,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6760137648809523,
      "model/head/update_ratio": 0.0013628187589347363,
      "model/head/weight_delta": 4.515878200531006,
      "model/head/weight_delta_rel": 0.07922188192605972,
      "model/head/weight_norm": 57.52837371826172,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41345274448394775,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41338488459587097,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41332709789276123,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2840819628645476,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08332034945487976,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05886205658316612,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5157470703125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019154553301632404,
      "model/modality_embedder.encoders.pose/weight_delta": 1.4578722715377808,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.047633230686187744,
      "model/modality_embedder.encoders.pose/weight_norm": 30.730060577392578,
      "model/modality_embedder/grad_frac": 0.08332034945487976,
      "model/modality_embedder/grad_norm": 0.05886205658316612,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5157470703125,
      "model/modality_embedder/update_ratio": 0.0019154553301632404,
      "model/modality_embedder/weight_delta": 1.4578722715377808,
      "model/modality_embedder/weight_delta_rel": 0.047633230686187744,
      "model/modality_embedder/weight_norm": 30.730060577392578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.48895263671875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.93466159611993,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.056031227111816,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.760914166538411,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10647600889205933,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.07522048056125641,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0027284021489322186,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.836006224155426,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.030464570969343185,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.569425582885742,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.93299102783203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.889308153817083,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.457911491394043,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.41695621852978,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09190883487462997,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06492943316698074,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002231042366474867,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.033996343612671,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.035818442702293396,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.10273551940918,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.59512329101562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.65198648904006,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.894352912902832,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.628285272949586,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09181055426597595,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06486000120639801,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002159593626856804,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.096211552619934,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.03680873289704323,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.033428192138672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.18517303466797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.584587191358025,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.610321044921875,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.95638656887533,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08232363313436508,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05815792456269264,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001975276507437229,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.9332550168037415,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03189422935247421,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.442928314208984,
      "model/normalizer/grad_frac": 0.3261444866657257,
      "model/normalizer/grad_norm": 0.23040632903575897,
      "model/normalizer/grad_zero_frac": 0.0001855329319369048,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0029574711807072163,
      "model/normalizer/weight_delta": 2.0075368881225586,
      "model/normalizer/weight_delta_rel": 0.025855911895632744,
      "model/normalizer/weight_norm": 77.90653228759766,
      "pose_mae_dtheta": 0.272622674703598,
      "pose_mae_dx": 0.07811390608549118,
      "pose_mae_dy": 0.06346259266138077,
      "pose_rmse_dtheta": 0.48058193922042847,
      "pose_rmse_dx": 0.17617428302764893,
      "pose_rmse_dy": 0.1551225185394287,
      "pose_rmse_mean": 0.2706262469291687,
      "rmse_dtheta": 0.05095618963241577,
      "rmse_dx": 0.02130301110446453,
      "rmse_dy": 0.009023749269545078,
      "rmse_mean": 0.027094317600131035,
      "rotation_flip": 0.013224821537733078,
      "sparse_tokens": 16158.0,
      "step": 1600,
      "turn_loss": 0.2050158828496933,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "epoch": 0.07433562534844824,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3358990252017975,
      "eval_objectnav_nopose_mae_dtheta": 0.04192462936043739,
      "eval_objectnav_nopose_mae_dx": 0.014749485068023205,
      "eval_objectnav_nopose_mae_dy": 0.005512702744454145,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.344673752784729,
      "eval_objectnav_nopose_pose_mae_dx": 0.11925675719976425,
      "eval_objectnav_nopose_pose_mae_dy": 0.06496121734380722,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5709543824195862,
      "eval_objectnav_nopose_pose_rmse_dx": 0.25545307993888855,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1519988626241684,
      "eval_objectnav_nopose_pose_rmse_mean": 0.32613545656204224,
      "eval_objectnav_nopose_rmse_dtheta": 0.05963152274489403,
      "eval_objectnav_nopose_rmse_dx": 0.027939992025494576,
      "eval_objectnav_nopose_rmse_dy": 0.01094046887010336,
      "eval_objectnav_nopose_rmse_mean": 0.03283733129501343,
      "eval_objectnav_nopose_rotation_flip": 0.014358436688780785,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3358990252017975,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 1600
    },
    {
      "epoch": 0.07433562534844824,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.30377891659736633,
      "eval_objectnav_pose_mae_dtheta": 0.03811235353350639,
      "eval_objectnav_pose_mae_dx": 0.012646405026316643,
      "eval_objectnav_pose_mae_dy": 0.005101376213133335,
      "eval_objectnav_pose_pose_mae_dtheta": 0.29902300238609314,
      "eval_objectnav_pose_pose_mae_dx": 0.1018521785736084,
      "eval_objectnav_pose_pose_mae_dy": 0.05614571273326874,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.513745129108429,
      "eval_objectnav_pose_pose_rmse_dx": 0.22802720963954926,
      "eval_objectnav_pose_pose_rmse_dy": 0.1369650959968567,
      "eval_objectnav_pose_pose_rmse_mean": 0.29291248321533203,
      "eval_objectnav_pose_rmse_dtheta": 0.05591730400919914,
      "eval_objectnav_pose_rmse_dx": 0.02524622157216072,
      "eval_objectnav_pose_rmse_dy": 0.010494016110897064,
      "eval_objectnav_pose_rmse_mean": 0.030552513897418976,
      "eval_objectnav_pose_rotation_flip": 0.01399767305701971,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.30377891659736633,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 1600
    },
    {
      "epoch": 0.07433562534844824,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10657056421041489,
      "eval_pointnav_mae_dtheta": 0.012003863230347633,
      "eval_pointnav_mae_dx": 0.0029684887267649174,
      "eval_pointnav_mae_dy": 0.002790004014968872,
      "eval_pointnav_pose_mae_dtheta": 0.08472103625535965,
      "eval_pointnav_pose_mae_dx": 0.033107176423072815,
      "eval_pointnav_pose_mae_dy": 0.03213337063789368,
      "eval_pointnav_pose_rmse_dtheta": 0.21479538083076477,
      "eval_pointnav_pose_rmse_dx": 0.09454777836799622,
      "eval_pointnav_pose_rmse_dy": 0.09195362776517868,
      "eval_pointnav_pose_rmse_mean": 0.13376560807228088,
      "eval_pointnav_rmse_dtheta": 0.026911750435829163,
      "eval_pointnav_rmse_dx": 0.008789267390966415,
      "eval_pointnav_rmse_dy": 0.00717537198215723,
      "eval_pointnav_rmse_mean": 0.014292130246758461,
      "eval_pointnav_rotation_flip": 0.005552629008889198,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10657056421041489,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 1600
    },
    {
      "epoch": 0.07433562534844824,
      "eval_loss": 0.2487495020031929,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3358990252017975,
      "eval_objectnav_nopose_mae_dtheta": 0.04192462936043739,
      "eval_objectnav_nopose_mae_dx": 0.014749485068023205,
      "eval_objectnav_nopose_mae_dy": 0.005512702744454145,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.344673752784729,
      "eval_objectnav_nopose_pose_mae_dx": 0.11925675719976425,
      "eval_objectnav_nopose_pose_mae_dy": 0.06496121734380722,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5709543824195862,
      "eval_objectnav_nopose_pose_rmse_dx": 0.25545307993888855,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1519988626241684,
      "eval_objectnav_nopose_pose_rmse_mean": 0.32613545656204224,
      "eval_objectnav_nopose_rmse_dtheta": 0.05963152274489403,
      "eval_objectnav_nopose_rmse_dx": 0.027939992025494576,
      "eval_objectnav_nopose_rmse_dy": 0.01094046887010336,
      "eval_objectnav_nopose_rmse_mean": 0.03283733129501343,
      "eval_objectnav_nopose_rotation_flip": 0.014358436688780785,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3358990252017975,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.30377891659736633,
      "eval_objectnav_pose_mae_dtheta": 0.03811235353350639,
      "eval_objectnav_pose_mae_dx": 0.012646405026316643,
      "eval_objectnav_pose_mae_dy": 0.005101376213133335,
      "eval_objectnav_pose_pose_mae_dtheta": 0.29902300238609314,
      "eval_objectnav_pose_pose_mae_dx": 0.1018521785736084,
      "eval_objectnav_pose_pose_mae_dy": 0.05614571273326874,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.513745129108429,
      "eval_objectnav_pose_pose_rmse_dx": 0.22802720963954926,
      "eval_objectnav_pose_pose_rmse_dy": 0.1369650959968567,
      "eval_objectnav_pose_pose_rmse_mean": 0.29291248321533203,
      "eval_objectnav_pose_rmse_dtheta": 0.05591730400919914,
      "eval_objectnav_pose_rmse_dx": 0.02524622157216072,
      "eval_objectnav_pose_rmse_dy": 0.010494016110897064,
      "eval_objectnav_pose_rmse_mean": 0.030552513897418976,
      "eval_objectnav_pose_rotation_flip": 0.01399767305701971,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.30377891659736633,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10657056421041489,
      "eval_pointnav_mae_dtheta": 0.012003863230347633,
      "eval_pointnav_mae_dx": 0.0029684887267649174,
      "eval_pointnav_mae_dy": 0.002790004014968872,
      "eval_pointnav_pose_mae_dtheta": 0.08472103625535965,
      "eval_pointnav_pose_mae_dx": 0.033107176423072815,
      "eval_pointnav_pose_mae_dy": 0.03213337063789368,
      "eval_pointnav_pose_rmse_dtheta": 0.21479538083076477,
      "eval_pointnav_pose_rmse_dx": 0.09454777836799622,
      "eval_pointnav_pose_rmse_dy": 0.09195362776517868,
      "eval_pointnav_pose_rmse_mean": 0.13376560807228088,
      "eval_pointnav_rmse_dtheta": 0.026911750435829163,
      "eval_pointnav_rmse_dx": 0.008789267390966415,
      "eval_pointnav_rmse_dy": 0.00717537198215723,
      "eval_pointnav_rmse_mean": 0.014292130246758461,
      "eval_pointnav_rotation_flip": 0.005552629008889198,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10657056421041489,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 1600
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.07438208511429102,
      "grad_norm": 0.4427330791950226,
      "learning_rate": 9.621923580633462e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.01199914887547493,
      "mae_dx": 0.0028482815250754356,
      "mae_dy": 0.0025909387040883303,
      "pose_mae_dtheta": 0.08629719167947769,
      "pose_mae_dx": 0.03369836509227753,
      "pose_mae_dy": 0.0313061848282814,
      "pose_rmse_dtheta": 0.2205323427915573,
      "pose_rmse_dx": 0.09407038241624832,
      "pose_rmse_dy": 0.06962712109088898,
      "pose_rmse_mean": 0.12807661294937134,
      "rmse_dtheta": 0.026964766904711723,
      "rmse_dx": 0.008893215097486973,
      "rmse_dy": 0.005936367437243462,
      "rmse_mean": 0.013931451365351677,
      "rotation_flip": 0.0032198713161051273,
      "sparse_tokens": 32057.0,
      "step": 1601,
      "turn_loss": 0.10238426923751831,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.0744285448801338,
      "grad_norm": 0.5883488059043884,
      "learning_rate": 9.62141904330405e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.02792196534574032,
      "mae_dx": 0.006639998871833086,
      "mae_dy": 0.005496703553944826,
      "pose_mae_dtheta": 0.2579838037490845,
      "pose_mae_dx": 0.07751322537660599,
      "pose_mae_dy": 0.09843488037586212,
      "pose_rmse_dtheta": 0.48216497898101807,
      "pose_rmse_dx": 0.1807813197374344,
      "pose_rmse_dy": 0.21240095794200897,
      "pose_rmse_mean": 0.2917824387550354,
      "rmse_dtheta": 0.04609058424830437,
      "rmse_dx": 0.0175218116492033,
      "rmse_dy": 0.010151643306016922,
      "rmse_mean": 0.02458801493048668,
      "rotation_flip": 0.0021929824724793434,
      "sparse_tokens": 9838.0,
      "step": 1602,
      "turn_loss": 0.18883691728115082,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.07447500464597659,
      "grad_norm": 0.44459596276283264,
      "learning_rate": 9.620914182796327e-06,
      "loss": 0.1478,
      "mae_dtheta": 0.026778461411595345,
      "mae_dx": 0.013155732303857803,
      "mae_dy": 0.005030822940170765,
      "pose_mae_dtheta": 0.1846868097782135,
      "pose_mae_dx": 0.09587433189153671,
      "pose_mae_dy": 0.06468196213245392,
      "pose_rmse_dtheta": 0.36997491121292114,
      "pose_rmse_dx": 0.22152088582515717,
      "pose_rmse_dy": 0.1555320769548416,
      "pose_rmse_mean": 0.24900929629802704,
      "rmse_dtheta": 0.04400363937020302,
      "rmse_dx": 0.026912076398730278,
      "rmse_dy": 0.01007919292896986,
      "rmse_mean": 0.026998301967978477,
      "rotation_flip": 0.013829787261784077,
      "sparse_tokens": 17680.0,
      "step": 1603,
      "turn_loss": 0.2444474697113037,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.07452146441181937,
      "grad_norm": 0.36032572388648987,
      "learning_rate": 9.620408999145594e-06,
      "loss": 0.1142,
      "mae_dtheta": 0.036803871393203735,
      "mae_dx": 0.009737974964082241,
      "mae_dy": 0.003526960499584675,
      "pose_mae_dtheta": 0.2940531075000763,
      "pose_mae_dx": 0.07815421372652054,
      "pose_mae_dy": 0.04936053603887558,
      "pose_rmse_dtheta": 0.5355347990989685,
      "pose_rmse_dx": 0.18934190273284912,
      "pose_rmse_dy": 0.1162935271859169,
      "pose_rmse_mean": 0.28039008378982544,
      "rmse_dtheta": 0.05652867630124092,
      "rmse_dx": 0.021919669583439827,
      "rmse_dy": 0.006780588533729315,
      "rmse_mean": 0.028409644961357117,
      "rotation_flip": 0.016116036102175713,
      "sparse_tokens": 20199.0,
      "step": 1604,
      "turn_loss": 0.25141656398773193,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07456792417766214,
      "grad_norm": 0.5074647068977356,
      "learning_rate": 9.61990349238718e-06,
      "loss": 0.1601,
      "mae_dtheta": 0.007986544631421566,
      "mae_dx": 0.0013612682232633233,
      "mae_dy": 0.0017021449748426676,
      "pose_mae_dtheta": 0.053036414086818695,
      "pose_mae_dx": 0.019581230357289314,
      "pose_mae_dy": 0.021413981914520264,
      "pose_rmse_dtheta": 0.15036241710186005,
      "pose_rmse_dx": 0.049990057945251465,
      "pose_rmse_dy": 0.050320662558078766,
      "pose_rmse_mean": 0.08355771750211716,
      "rmse_dtheta": 0.02013654075562954,
      "rmse_dx": 0.003845625091344118,
      "rmse_dy": 0.004006034694612026,
      "rmse_mean": 0.009329400025308132,
      "rotation_flip": 0.005633802618831396,
      "sparse_tokens": 32105.0,
      "step": 1605,
      "turn_loss": 0.06898442655801773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.07461438394350492,
      "grad_norm": 0.4400923550128937,
      "learning_rate": 9.619397662556434e-06,
      "loss": 0.0925,
      "mae_dtheta": 0.008773237466812134,
      "mae_dx": 0.0018653037259355187,
      "mae_dy": 0.001874995999969542,
      "pose_mae_dtheta": 0.061716869473457336,
      "pose_mae_dx": 0.023719200864434242,
      "pose_mae_dy": 0.0254732146859169,
      "pose_rmse_dtheta": 0.12817320227622986,
      "pose_rmse_dx": 0.05326792597770691,
      "pose_rmse_dy": 0.0609586127102375,
      "pose_rmse_mean": 0.08079991489648819,
      "rmse_dtheta": 0.018272994086146355,
      "rmse_dx": 0.005056544207036495,
      "rmse_dy": 0.003991762176156044,
      "rmse_mean": 0.00910709984600544,
      "rotation_flip": 0.0037537538446485996,
      "sparse_tokens": 32169.0,
      "step": 1606,
      "turn_loss": 0.07205743342638016,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07466084370934771,
      "grad_norm": 0.6260806322097778,
      "learning_rate": 9.618891509688731e-06,
      "loss": 0.1986,
      "mae_dtheta": 0.011498806066811085,
      "mae_dx": 0.0025755614042282104,
      "mae_dy": 0.002995984395965934,
      "pose_mae_dtheta": 0.08400782942771912,
      "pose_mae_dx": 0.036285556852817535,
      "pose_mae_dy": 0.03905835002660751,
      "pose_rmse_dtheta": 0.16627345979213715,
      "pose_rmse_dx": 0.11448873579502106,
      "pose_rmse_dy": 0.08971722424030304,
      "pose_rmse_mean": 0.12349313497543335,
      "rmse_dtheta": 0.021526701748371124,
      "rmse_dx": 0.007372426334768534,
      "rmse_dy": 0.0067975581623613834,
      "rmse_mean": 0.011898895725607872,
      "rotation_flip": 0.005225830711424351,
      "sparse_tokens": 32105.0,
      "step": 1607,
      "turn_loss": 0.11204330623149872,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35364.0,
      "epoch": 0.07470730347519049,
      "grad_norm": 0.666732668876648,
      "learning_rate": 9.618385033819466e-06,
      "loss": 0.1866,
      "mae_dtheta": 0.031587522476911545,
      "mae_dx": 0.012161321938037872,
      "mae_dy": 0.005473543889820576,
      "pose_mae_dtheta": 0.25758567452430725,
      "pose_mae_dx": 0.09333140403032303,
      "pose_mae_dy": 0.07632042467594147,
      "pose_rmse_dtheta": 0.4607166349887848,
      "pose_rmse_dx": 0.20524534583091736,
      "pose_rmse_dy": 0.19246548414230347,
      "pose_rmse_mean": 0.286142498254776,
      "rmse_dtheta": 0.04878867790102959,
      "rmse_dx": 0.024703921750187874,
      "rmse_dy": 0.010444192215800285,
      "rmse_mean": 0.027978932484984398,
      "rotation_flip": 0.015748031437397003,
      "sparse_tokens": 27360.0,
      "step": 1608,
      "turn_loss": 0.26245570182800293,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07475376324103326,
      "grad_norm": 0.5154903531074524,
      "learning_rate": 9.617878234984056e-06,
      "loss": 0.0963,
      "mae_dtheta": 0.008846904151141644,
      "mae_dx": 0.001567747094668448,
      "mae_dy": 0.0023146318271756172,
      "pose_mae_dtheta": 0.05358212813735008,
      "pose_mae_dx": 0.022226985543966293,
      "pose_mae_dy": 0.023147720843553543,
      "pose_rmse_dtheta": 0.10534465312957764,
      "pose_rmse_dx": 0.055007122457027435,
      "pose_rmse_dy": 0.054770179092884064,
      "pose_rmse_mean": 0.07170732319355011,
      "rmse_dtheta": 0.017823554575443268,
      "rmse_dx": 0.004443116020411253,
      "rmse_dy": 0.00507727125659585,
      "rmse_mean": 0.009114647284150124,
      "rotation_flip": 0.0022379709407687187,
      "sparse_tokens": 32121.0,
      "step": 1609,
      "turn_loss": 0.07714585214853287,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.07480022300687604,
      "grad_norm": 0.6278404593467712,
      "learning_rate": 9.617371113217943e-06,
      "loss": 0.1778,
      "mae_dtheta": 0.02333388291299343,
      "mae_dx": 0.013387182727456093,
      "mae_dy": 0.004170037340372801,
      "pose_mae_dtheta": 0.1453736126422882,
      "pose_mae_dx": 0.08589745312929153,
      "pose_mae_dy": 0.057767581194639206,
      "pose_rmse_dtheta": 0.23542355000972748,
      "pose_rmse_dx": 0.2210094928741455,
      "pose_rmse_dy": 0.15779218077659607,
      "pose_rmse_mean": 0.20474176108837128,
      "rmse_dtheta": 0.036109913140535355,
      "rmse_dx": 0.02689349092543125,
      "rmse_dy": 0.008536813780665398,
      "rmse_mean": 0.023846741765737534,
      "rotation_flip": 0.01729106716811657,
      "sparse_tokens": 5482.0,
      "step": 1610,
      "turn_loss": 0.23835425078868866,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07484668277271883,
      "grad_norm": 0.5668055415153503,
      "learning_rate": 9.616863668556588e-06,
      "loss": 0.1659,
      "mae_dtheta": 0.012262837029993534,
      "mae_dx": 0.0027901302091777325,
      "mae_dy": 0.00304626883007586,
      "pose_mae_dtheta": 0.0834285169839859,
      "pose_mae_dx": 0.028901631012558937,
      "pose_mae_dy": 0.028834853321313858,
      "pose_rmse_dtheta": 0.23329207301139832,
      "pose_rmse_dx": 0.07888327538967133,
      "pose_rmse_dy": 0.07446025311946869,
      "pose_rmse_mean": 0.12887853384017944,
      "rmse_dtheta": 0.028288906440138817,
      "rmse_dx": 0.008238001726567745,
      "rmse_dy": 0.0077997720800340176,
      "rmse_mean": 0.014775559306144714,
      "rotation_flip": 0.007459207437932491,
      "sparse_tokens": 32073.0,
      "step": 1611,
      "turn_loss": 0.11314989626407623,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07489314253856161,
      "grad_norm": 0.3776687979698181,
      "learning_rate": 9.61635590103548e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.009341313503682613,
      "mae_dx": 0.0017036169301718473,
      "mae_dy": 0.0023355211596935987,
      "pose_mae_dtheta": 0.06360892951488495,
      "pose_mae_dx": 0.023766787722706795,
      "pose_mae_dy": 0.027038417756557465,
      "pose_rmse_dtheta": 0.18001142144203186,
      "pose_rmse_dx": 0.06551151722669601,
      "pose_rmse_dy": 0.07498650252819061,
      "pose_rmse_mean": 0.1068364828824997,
      "rmse_dtheta": 0.023256618529558182,
      "rmse_dx": 0.004763132892549038,
      "rmse_dy": 0.0058387769386172295,
      "rmse_mean": 0.0112861767411232,
      "rotation_flip": 0.005090236198157072,
      "sparse_tokens": 32073.0,
      "step": 1612,
      "turn_loss": 0.08398497104644775,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.07493960230440438,
      "grad_norm": 0.6704385876655579,
      "learning_rate": 9.615847810690128e-06,
      "loss": 0.1941,
      "mae_dtheta": 0.017968064174056053,
      "mae_dx": 0.0033533554524183273,
      "mae_dy": 0.004026809707283974,
      "pose_mae_dtheta": 0.130248561501503,
      "pose_mae_dx": 0.038928158581256866,
      "pose_mae_dy": 0.04675363004207611,
      "pose_rmse_dtheta": 0.3100677728652954,
      "pose_rmse_dx": 0.08609757572412491,
      "pose_rmse_dy": 0.10883031040430069,
      "pose_rmse_mean": 0.16833189129829407,
      "rmse_dtheta": 0.035697609186172485,
      "rmse_dx": 0.010303689166903496,
      "rmse_dy": 0.009674610570073128,
      "rmse_mean": 0.01855863630771637,
      "rotation_flip": 0.006199853960424662,
      "sparse_tokens": 32137.0,
      "step": 1613,
      "turn_loss": 0.15259180963039398,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07498606207024716,
      "grad_norm": 0.6004957556724548,
      "learning_rate": 9.615339397556058e-06,
      "loss": 0.1112,
      "mae_dtheta": 0.008642268367111683,
      "mae_dx": 0.0019509210251271725,
      "mae_dy": 0.0015396816888824105,
      "pose_mae_dtheta": 0.060531146824359894,
      "pose_mae_dx": 0.02120727114379406,
      "pose_mae_dy": 0.019957294687628746,
      "pose_rmse_dtheta": 0.15956449508666992,
      "pose_rmse_dx": 0.052144572138786316,
      "pose_rmse_dy": 0.05007520690560341,
      "pose_rmse_mean": 0.08726143091917038,
      "rmse_dtheta": 0.020942803472280502,
      "rmse_dx": 0.005849229171872139,
      "rmse_dy": 0.004107974935323,
      "rmse_mean": 0.010300002992153168,
      "rotation_flip": 0.0020639835856854916,
      "sparse_tokens": 32105.0,
      "step": 1614,
      "turn_loss": 0.07125168293714523,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07503252183608995,
      "grad_norm": 0.6366421580314636,
      "learning_rate": 9.61483066166883e-06,
      "loss": 0.2106,
      "mae_dtheta": 0.014164586551487446,
      "mae_dx": 0.0044866385869681835,
      "mae_dy": 0.003961778245866299,
      "pose_mae_dtheta": 0.1043650358915329,
      "pose_mae_dx": 0.03880123049020767,
      "pose_mae_dy": 0.036862704902887344,
      "pose_rmse_dtheta": 0.26686039566993713,
      "pose_rmse_dx": 0.12322496622800827,
      "pose_rmse_dy": 0.10245111584663391,
      "pose_rmse_mean": 0.16417883336544037,
      "rmse_dtheta": 0.03199433162808418,
      "rmse_dx": 0.015115821734070778,
      "rmse_dy": 0.01146566029638052,
      "rmse_mean": 0.019525272771716118,
      "rotation_flip": 0.010979359038174152,
      "sparse_tokens": 32105.0,
      "step": 1615,
      "turn_loss": 0.14463794231414795,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.07507898160193273,
      "grad_norm": 0.5501816868782043,
      "learning_rate": 9.614321603064014e-06,
      "loss": 0.1856,
      "mae_dtheta": 0.032876137644052505,
      "mae_dx": 0.012012705206871033,
      "mae_dy": 0.0033880621194839478,
      "pose_mae_dtheta": 0.23103450238704681,
      "pose_mae_dx": 0.07680103927850723,
      "pose_mae_dy": 0.04287882521748543,
      "pose_rmse_dtheta": 0.4602016508579254,
      "pose_rmse_dx": 0.1641436666250229,
      "pose_rmse_dy": 0.09409558027982712,
      "pose_rmse_mean": 0.23948030173778534,
      "rmse_dtheta": 0.05165497586131096,
      "rmse_dx": 0.023225467652082443,
      "rmse_dy": 0.0061328415758907795,
      "rmse_mean": 0.027004428207874298,
      "rotation_flip": 0.007194244768470526,
      "sparse_tokens": 9079.0,
      "step": 1616,
      "turn_loss": 0.18602526187896729,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 15220.0,
      "epoch": 0.0751254413677755,
      "grad_norm": 0.6038345098495483,
      "learning_rate": 9.613812221777212e-06,
      "loss": 0.1723,
      "mae_dtheta": 0.039519645273685455,
      "mae_dx": 0.016374193131923676,
      "mae_dy": 0.009816898964345455,
      "pose_mae_dtheta": 0.3094675838947296,
      "pose_mae_dx": 0.11794234067201614,
      "pose_mae_dy": 0.1164480447769165,
      "pose_rmse_dtheta": 0.5133988857269287,
      "pose_rmse_dx": 0.2356116622686386,
      "pose_rmse_dy": 0.23419560492038727,
      "pose_rmse_mean": 0.32773539423942566,
      "rmse_dtheta": 0.05550891533493996,
      "rmse_dx": 0.02970944717526436,
      "rmse_dy": 0.016754766926169395,
      "rmse_mean": 0.033991046249866486,
      "rotation_flip": 0.011594203300774097,
      "sparse_tokens": 12705.0,
      "step": 1617,
      "turn_loss": 0.30846330523490906,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.07517190113361828,
      "grad_norm": 0.5469588041305542,
      "learning_rate": 9.613302517844045e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.009409472346305847,
      "mae_dx": 0.0014485148712992668,
      "mae_dy": 0.002605567453429103,
      "pose_mae_dtheta": 0.06118648126721382,
      "pose_mae_dx": 0.02110370248556137,
      "pose_mae_dy": 0.028164971619844437,
      "pose_rmse_dtheta": 0.14154310524463654,
      "pose_rmse_dx": 0.05611976608633995,
      "pose_rmse_dy": 0.06566969305276871,
      "pose_rmse_mean": 0.0877775251865387,
      "rmse_dtheta": 0.020052103325724602,
      "rmse_dx": 0.0046815695241093636,
      "rmse_dy": 0.005506159272044897,
      "rmse_mean": 0.010079944506287575,
      "rotation_flip": 0.00668151443824172,
      "sparse_tokens": 32041.0,
      "step": 1618,
      "turn_loss": 0.07346853613853455,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.07521836089946107,
      "grad_norm": 0.4132784605026245,
      "learning_rate": 9.612792491300158e-06,
      "loss": 0.1235,
      "mae_dtheta": 0.03573303297162056,
      "mae_dx": 0.008733067661523819,
      "mae_dy": 0.006114344112575054,
      "pose_mae_dtheta": 0.27232784032821655,
      "pose_mae_dx": 0.07923825830221176,
      "pose_mae_dy": 0.06923985481262207,
      "pose_rmse_dtheta": 0.5235379338264465,
      "pose_rmse_dx": 0.17566443979740143,
      "pose_rmse_dy": 0.16424818336963654,
      "pose_rmse_mean": 0.2878168523311615,
      "rmse_dtheta": 0.05587751418352127,
      "rmse_dx": 0.018676575273275375,
      "rmse_dy": 0.011678374372422695,
      "rmse_mean": 0.028744153678417206,
      "rotation_flip": 0.020123839378356934,
      "sparse_tokens": 23228.0,
      "step": 1619,
      "turn_loss": 0.23621618747711182,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.07526482066530385,
      "grad_norm": 0.3959677517414093,
      "learning_rate": 9.612282142181216e-06,
      "loss": 0.0912,
      "mae_dtheta": 0.008210737258195877,
      "mae_dx": 0.001925526070408523,
      "mae_dy": 0.0011078788666054606,
      "pose_mae_dtheta": 0.060717880725860596,
      "pose_mae_dx": 0.02103688195347786,
      "pose_mae_dy": 0.017145710065960884,
      "pose_rmse_dtheta": 0.1755361258983612,
      "pose_rmse_dx": 0.060718826949596405,
      "pose_rmse_dy": 0.04758904501795769,
      "pose_rmse_mean": 0.0946146696805954,
      "rmse_dtheta": 0.020824246108531952,
      "rmse_dx": 0.006882653571665287,
      "rmse_dy": 0.0025613196194171906,
      "rmse_mean": 0.010089406743645668,
      "rotation_flip": 0.00477326987311244,
      "sparse_tokens": 32137.0,
      "step": 1620,
      "turn_loss": 0.060739584267139435,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07531128043114663,
      "grad_norm": 0.41514381766319275,
      "learning_rate": 9.611771470522908e-06,
      "loss": 0.1243,
      "mae_dtheta": 0.013631605543196201,
      "mae_dx": 0.0032774400897324085,
      "mae_dy": 0.003259555669501424,
      "pose_mae_dtheta": 0.09314600378274918,
      "pose_mae_dx": 0.03134654089808464,
      "pose_mae_dy": 0.037542495876550674,
      "pose_rmse_dtheta": 0.19626390933990479,
      "pose_rmse_dx": 0.08954745531082153,
      "pose_rmse_dy": 0.09607896208763123,
      "pose_rmse_mean": 0.12729677557945251,
      "rmse_dtheta": 0.027782833203673363,
      "rmse_dx": 0.009770611301064491,
      "rmse_dy": 0.008512426167726517,
      "rmse_mean": 0.015355290845036507,
      "rotation_flip": 0.00842572096735239,
      "sparse_tokens": 32089.0,
      "step": 1621,
      "turn_loss": 0.14555227756500244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6822.0,
      "epoch": 0.0753577401969894,
      "grad_norm": 0.40524643659591675,
      "learning_rate": 9.611260476360944e-06,
      "loss": 0.107,
      "mae_dtheta": 0.026217056438326836,
      "mae_dx": 0.01082506775856018,
      "mae_dy": 0.007342984434217215,
      "pose_mae_dtheta": 0.1864941418170929,
      "pose_mae_dx": 0.07467692345380783,
      "pose_mae_dy": 0.07517609745264053,
      "pose_rmse_dtheta": 0.2817261815071106,
      "pose_rmse_dx": 0.15377791225910187,
      "pose_rmse_dy": 0.20320522785186768,
      "pose_rmse_mean": 0.21290311217308044,
      "rmse_dtheta": 0.039201926440000534,
      "rmse_dx": 0.021158367395401,
      "rmse_dy": 0.017509089782834053,
      "rmse_mean": 0.02595646306872368,
      "rotation_flip": 0.006230529397726059,
      "sparse_tokens": 5706.0,
      "step": 1622,
      "turn_loss": 0.28084659576416016,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 7147.0,
      "epoch": 0.0754041999628322,
      "grad_norm": 0.6234808564186096,
      "learning_rate": 9.610749159731063e-06,
      "loss": 0.1481,
      "mae_dtheta": 0.05499819666147232,
      "mae_dx": 0.01475364901125431,
      "mae_dy": 0.011026347987353802,
      "pose_mae_dtheta": 0.42878949642181396,
      "pose_mae_dx": 0.12432526051998138,
      "pose_mae_dy": 0.1545250415802002,
      "pose_rmse_dtheta": 0.6492266058921814,
      "pose_rmse_dx": 0.256509006023407,
      "pose_rmse_dy": 0.28237345814704895,
      "pose_rmse_mean": 0.3960363566875458,
      "rmse_dtheta": 0.07227011024951935,
      "rmse_dx": 0.027081497013568878,
      "rmse_dy": 0.020106948912143707,
      "rmse_mean": 0.039819519966840744,
      "rotation_flip": 0.015337423421442509,
      "sparse_tokens": 5742.0,
      "step": 1623,
      "turn_loss": 0.49453800916671753,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.07545065972867497,
      "grad_norm": 0.5139496922492981,
      "learning_rate": 9.610237520669018e-06,
      "loss": 0.0835,
      "mae_dtheta": 0.00930938869714737,
      "mae_dx": 0.002881005872040987,
      "mae_dy": 0.0005035411450080574,
      "pose_mae_dtheta": 0.06582603603601456,
      "pose_mae_dx": 0.023158805444836617,
      "pose_mae_dy": 0.006509601138532162,
      "pose_rmse_dtheta": 0.22774426639080048,
      "pose_rmse_dx": 0.05906447023153305,
      "pose_rmse_dy": 0.018202954903244972,
      "pose_rmse_mean": 0.10167056322097778,
      "rmse_dtheta": 0.029724016785621643,
      "rmse_dx": 0.007304218597710133,
      "rmse_dy": 0.0015481036389246583,
      "rmse_mean": 0.012858780100941658,
      "rotation_flip": 0.0010683761211112142,
      "sparse_tokens": 32265.0,
      "step": 1624,
      "turn_loss": 0.06681638956069946,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07549711949451775,
      "grad_norm": 0.635155975818634,
      "learning_rate": 9.609725559210587e-06,
      "loss": 0.1692,
      "mae_dtheta": 0.009780734777450562,
      "mae_dx": 0.0018389781471341848,
      "mae_dy": 0.002659699646756053,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6351559162139893,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 163.80931091308594,
      "model/head/act_norm_mean": 113.76329703282828,
      "model/head/act_norm_min": 61.641727447509766,
      "model/head/act_over_embed": 78.17920278972684,
      "model/head/grad_frac": 0.11004160344600677,
      "model/head/grad_norm": 0.06989357620477676,
      "model/head/grad_zero_frac": 0.00019575668557081372,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6902176057449495,
      "model/head/update_ratio": 0.001214778982102871,
      "model/head/weight_delta": 4.547929763793945,
      "model/head/weight_delta_rel": 0.07978416234254837,
      "model/head/weight_norm": 57.536041259765625,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4135092794895172,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41341894837819276,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4133586287498474,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2841053718146693,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10047274082899094,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06381585448980331,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5305186929223744,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0020766069646924734,
      "model/modality_embedder.encoders.pose/weight_delta": 1.4674618244171143,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.04794654995203018,
      "model/modality_embedder.encoders.pose/weight_norm": 30.7308292388916,
      "model/modality_embedder/grad_frac": 0.10047274082899094,
      "model/modality_embedder/grad_norm": 0.06381585448980331,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5305186929223744,
      "model/modality_embedder/update_ratio": 0.0020766069646924734,
      "model/modality_embedder/weight_delta": 1.4674618244171143,
      "model/modality_embedder/weight_delta_rel": 0.04794654995203018,
      "model/modality_embedder/weight_norm": 30.7308292388916,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.43927001953125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.741489798781465,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.896081924438477,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.31537406105206,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08239606767892838,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05233434960246086,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001898156595416367,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.8460549712181091,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.030830753967165947,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.571144104003906,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.80045318603516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.79625370771204,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.195549964904785,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.040217694124447,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08234018832445145,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.052298858761787415,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017968254396691918,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.0478150844573975,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.036297135055065155,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.10625457763672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.83390808105469,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.74946889530223,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.64411449432373,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.382485457325117,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08196348696947098,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0520595945417881,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017332041170448065,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.110976219177246,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.03730450198054314,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.03662109375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.41364288330078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.607563732563733,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.788262367248535,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.659385625249165,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08938725292682648,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.056774843484163284,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019280443666502833,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.9470443725585938,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03236548230051994,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.446855545043945,
      "model/normalizer/grad_frac": 0.36291906237602234,
      "model/normalizer/grad_norm": 0.2305101901292801,
      "model/normalizer/grad_zero_frac": 0.00018316945352125913,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002958640456199646,
      "model/normalizer/weight_delta": 2.0344486236572266,
      "model/normalizer/weight_delta_rel": 0.026202520355582237,
      "model/normalizer/weight_norm": 77.91085052490234,
      "pose_mae_dtheta": 0.0686592385172844,
      "pose_mae_dx": 0.0254119411110878,
      "pose_mae_dy": 0.03506409004330635,
      "pose_rmse_dtheta": 0.14829854667186737,
      "pose_rmse_dx": 0.06297305226325989,
      "pose_rmse_dy": 0.08466243743896484,
      "pose_rmse_mean": 0.0986446738243103,
      "rmse_dtheta": 0.020772112533450127,
      "rmse_dx": 0.005303251091390848,
      "rmse_dy": 0.005620650947093964,
      "rmse_mean": 0.010565338656306267,
      "rotation_flip": 0.006259027402848005,
      "sparse_tokens": 32073.0,
      "step": 1625,
      "turn_loss": 0.08839604258537292,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.07554357926036052,
      "grad_norm": 0.42361828684806824,
      "learning_rate": 9.609213275391573e-06,
      "loss": 0.127,
      "mae_dtheta": 0.010745004750788212,
      "mae_dx": 0.002620661398395896,
      "mae_dy": 0.002602282678708434,
      "pose_mae_dtheta": 0.07768246531486511,
      "pose_mae_dx": 0.028553368523716927,
      "pose_mae_dy": 0.02944345772266388,
      "pose_rmse_dtheta": 0.2174694985151291,
      "pose_rmse_dx": 0.09512859582901001,
      "pose_rmse_dy": 0.08204589039087296,
      "pose_rmse_mean": 0.13154800236225128,
      "rmse_dtheta": 0.024430524557828903,
      "rmse_dx": 0.00925830751657486,
      "rmse_dy": 0.007440543733537197,
      "rmse_mean": 0.013709792867302895,
      "rotation_flip": 0.005248091649264097,
      "sparse_tokens": 32057.0,
      "step": 1626,
      "turn_loss": 0.1044885441660881,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.0755900390262033,
      "grad_norm": 0.8656795024871826,
      "learning_rate": 9.608700669247803e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.02992353029549122,
      "mae_dx": 0.008639763109385967,
      "mae_dy": 0.004301344510167837,
      "pose_mae_dtheta": 0.2442207634449005,
      "pose_mae_dx": 0.051211897283792496,
      "pose_mae_dy": 0.047441743314266205,
      "pose_rmse_dtheta": 0.4693048298358917,
      "pose_rmse_dx": 0.14952366054058075,
      "pose_rmse_dy": 0.14536139369010925,
      "pose_rmse_mean": 0.2547299563884735,
      "rmse_dtheta": 0.0476965606212616,
      "rmse_dx": 0.020093899220228195,
      "rmse_dy": 0.009881163015961647,
      "rmse_mean": 0.025890542194247246,
      "rotation_flip": 0.015130674466490746,
      "sparse_tokens": 11190.0,
      "step": 1627,
      "turn_loss": 0.22261947393417358,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 21034.0,
      "epoch": 0.07563649879204609,
      "grad_norm": 0.8403240442276001,
      "learning_rate": 9.60818774081512e-06,
      "loss": 0.2543,
      "mae_dtheta": 0.036735761910676956,
      "mae_dx": 0.010694059543311596,
      "mae_dy": 0.00605537137016654,
      "pose_mae_dtheta": 0.27109241485595703,
      "pose_mae_dx": 0.09585738927125931,
      "pose_mae_dy": 0.08663462102413177,
      "pose_rmse_dtheta": 0.45435699820518494,
      "pose_rmse_dx": 0.2165609449148178,
      "pose_rmse_dy": 0.1915823221206665,
      "pose_rmse_mean": 0.2875000834465027,
      "rmse_dtheta": 0.053872108459472656,
      "rmse_dx": 0.02241683192551136,
      "rmse_dy": 0.011835815384984016,
      "rmse_mean": 0.029374917969107628,
      "rotation_flip": 0.015488867647945881,
      "sparse_tokens": 17598.0,
      "step": 1628,
      "turn_loss": 0.2728208005428314,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.07568295855788887,
      "grad_norm": 0.6199848651885986,
      "learning_rate": 9.607674490129394e-06,
      "loss": 0.1788,
      "mae_dtheta": 0.018146226182579994,
      "mae_dx": 0.004724713973701,
      "mae_dy": 0.004461935721337795,
      "pose_mae_dtheta": 0.14623305201530457,
      "pose_mae_dx": 0.042015064507722855,
      "pose_mae_dy": 0.041015446186065674,
      "pose_rmse_dtheta": 0.3500014543533325,
      "pose_rmse_dx": 0.10066744685173035,
      "pose_rmse_dy": 0.11100175231695175,
      "pose_rmse_mean": 0.18722355365753174,
      "rmse_dtheta": 0.03687198832631111,
      "rmse_dx": 0.011974134482443333,
      "rmse_dy": 0.011667462065815926,
      "rmse_mean": 0.02017119526863098,
      "rotation_flip": 0.009819967672228813,
      "sparse_tokens": 32233.0,
      "step": 1629,
      "turn_loss": 0.1628672033548355,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.07572941832373165,
      "grad_norm": 0.7866935133934021,
      "learning_rate": 9.607160917226521e-06,
      "loss": 0.2309,
      "mae_dtheta": 0.03805548697710037,
      "mae_dx": 0.008007708936929703,
      "mae_dy": 0.0036068216431885958,
      "pose_mae_dtheta": 0.3146778345108032,
      "pose_mae_dx": 0.06464727222919464,
      "pose_mae_dy": 0.03364699333906174,
      "pose_rmse_dtheta": 0.5839278697967529,
      "pose_rmse_dx": 0.14512257277965546,
      "pose_rmse_dy": 0.08173876255750656,
      "pose_rmse_mean": 0.27026307582855225,
      "rmse_dtheta": 0.05751172453165054,
      "rmse_dx": 0.017047200351953506,
      "rmse_dy": 0.00721448939293623,
      "rmse_mean": 0.027257805690169334,
      "rotation_flip": 0.017073171213269234,
      "sparse_tokens": 6400.0,
      "step": 1630,
      "turn_loss": 0.24268066883087158,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07577587808957442,
      "grad_norm": 0.5846028923988342,
      "learning_rate": 9.606647022142411e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.01292574405670166,
      "mae_dx": 0.0023328629322350025,
      "mae_dy": 0.0026073933113366365,
      "pose_mae_dtheta": 0.0916769877076149,
      "pose_mae_dx": 0.03076934441924095,
      "pose_mae_dy": 0.035357024520635605,
      "pose_rmse_dtheta": 0.22178585827350616,
      "pose_rmse_dx": 0.07790592312812805,
      "pose_rmse_dy": 0.09373738616704941,
      "pose_rmse_mean": 0.13114306330680847,
      "rmse_dtheta": 0.02769763581454754,
      "rmse_dx": 0.0072014592587947845,
      "rmse_dy": 0.005478340201079845,
      "rmse_mean": 0.013459145091474056,
      "rotation_flip": 0.005396429914981127,
      "sparse_tokens": 32089.0,
      "step": 1631,
      "turn_loss": 0.09935812652111053,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.07582233785541721,
      "grad_norm": 0.6198493242263794,
      "learning_rate": 9.606132804913e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.008929072879254818,
      "mae_dx": 0.002706532832235098,
      "mae_dy": 0.0022014493588358164,
      "pose_mae_dtheta": 0.06678658723831177,
      "pose_mae_dx": 0.023761887103319168,
      "pose_mae_dy": 0.02384493686258793,
      "pose_rmse_dtheta": 0.18043571710586548,
      "pose_rmse_dx": 0.07883979380130768,
      "pose_rmse_dy": 0.06197531893849373,
      "pose_rmse_mean": 0.10708361119031906,
      "rmse_dtheta": 0.021839918568730354,
      "rmse_dx": 0.009332624264061451,
      "rmse_dy": 0.007142495363950729,
      "rmse_mean": 0.012771680019795895,
      "rotation_flip": 0.002421307610347867,
      "sparse_tokens": 32057.0,
      "step": 1632,
      "turn_loss": 0.07845041155815125,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20775.0,
      "epoch": 0.07586879762125999,
      "grad_norm": 0.6066305041313171,
      "learning_rate": 9.60561826557425e-06,
      "loss": 0.167,
      "mae_dtheta": 0.02753150835633278,
      "mae_dx": 0.012839073315262794,
      "mae_dy": 0.0022767302580177784,
      "pose_mae_dtheta": 0.20931647717952728,
      "pose_mae_dx": 0.0975915789604187,
      "pose_mae_dy": 0.023857397958636284,
      "pose_rmse_dtheta": 0.39547789096832275,
      "pose_rmse_dx": 0.24466784298419952,
      "pose_rmse_dy": 0.06217770278453827,
      "pose_rmse_mean": 0.2341078221797943,
      "rmse_dtheta": 0.0445278026163578,
      "rmse_dx": 0.02636672370135784,
      "rmse_dy": 0.004741798620671034,
      "rmse_mean": 0.025212107226252556,
      "rotation_flip": 0.004878048785030842,
      "sparse_tokens": 16279.0,
      "step": 1633,
      "turn_loss": 0.22481206059455872,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.07591525738710277,
      "grad_norm": 0.5843834280967712,
      "learning_rate": 9.605103404162146e-06,
      "loss": 0.1368,
      "mae_dtheta": 0.010879665613174438,
      "mae_dx": 0.002224016934633255,
      "mae_dy": 0.0017881088424474,
      "pose_mae_dtheta": 0.08023097366094589,
      "pose_mae_dx": 0.022762270644307137,
      "pose_mae_dy": 0.02098798006772995,
      "pose_rmse_dtheta": 0.23937560617923737,
      "pose_rmse_dx": 0.05143333971500397,
      "pose_rmse_dy": 0.04929216206073761,
      "pose_rmse_mean": 0.11336704343557358,
      "rmse_dtheta": 0.02704755961894989,
      "rmse_dx": 0.006170989479869604,
      "rmse_dy": 0.0039033221546560526,
      "rmse_mean": 0.012373956851661205,
      "rotation_flip": 0.0010853834683075547,
      "sparse_tokens": 32201.0,
      "step": 1634,
      "turn_loss": 0.07924464344978333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.07596171715294554,
      "grad_norm": 0.5721227526664734,
      "learning_rate": 9.604588220712688e-06,
      "loss": 0.151,
      "mae_dtheta": 0.03410864993929863,
      "mae_dx": 0.013781668618321419,
      "mae_dy": 0.0037499302998185158,
      "pose_mae_dtheta": 0.2540830969810486,
      "pose_mae_dx": 0.10387251526117325,
      "pose_mae_dy": 0.034072600305080414,
      "pose_rmse_dtheta": 0.4319397211074829,
      "pose_rmse_dx": 0.22691605985164642,
      "pose_rmse_dy": 0.10604481399059296,
      "pose_rmse_mean": 0.2549668848514557,
      "rmse_dtheta": 0.05085163190960884,
      "rmse_dx": 0.02661297470331192,
      "rmse_dy": 0.009803719818592072,
      "rmse_mean": 0.029089443385601044,
      "rotation_flip": 0.011041009798645973,
      "sparse_tokens": 13071.0,
      "step": 1635,
      "turn_loss": 0.24794109165668488,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07600817691878833,
      "grad_norm": 0.5386638641357422,
      "learning_rate": 9.604072715261902e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.01520845852792263,
      "mae_dx": 0.00253950129263103,
      "mae_dy": 0.0033471318893134594,
      "pose_mae_dtheta": 0.10796426236629486,
      "pose_mae_dx": 0.03259909898042679,
      "pose_mae_dy": 0.043879322707653046,
      "pose_rmse_dtheta": 0.25067082047462463,
      "pose_rmse_dx": 0.07897944748401642,
      "pose_rmse_dy": 0.10597454756498337,
      "pose_rmse_mean": 0.14520828425884247,
      "rmse_dtheta": 0.029494348913431168,
      "rmse_dx": 0.007088127546012402,
      "rmse_dy": 0.006638311315327883,
      "rmse_mean": 0.014406929723918438,
      "rotation_flip": 0.00944032333791256,
      "sparse_tokens": 32121.0,
      "step": 1636,
      "turn_loss": 0.12092120200395584,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.07605463668463111,
      "grad_norm": 1.1368216276168823,
      "learning_rate": 9.603556887845841e-06,
      "loss": 0.2818,
      "mae_dtheta": 0.03534867241978645,
      "mae_dx": 0.014422659762203693,
      "mae_dy": 0.005779198370873928,
      "pose_mae_dtheta": 0.2768300771713257,
      "pose_mae_dx": 0.11404356360435486,
      "pose_mae_dy": 0.05787559226155281,
      "pose_rmse_dtheta": 0.4842941164970398,
      "pose_rmse_dx": 0.22135286033153534,
      "pose_rmse_dy": 0.14087329804897308,
      "pose_rmse_mean": 0.2821734547615051,
      "rmse_dtheta": 0.05347372218966484,
      "rmse_dx": 0.026950042694807053,
      "rmse_dy": 0.011117083951830864,
      "rmse_mean": 0.030513618141412735,
      "rotation_flip": 0.007926023565232754,
      "sparse_tokens": 13231.0,
      "step": 1637,
      "turn_loss": 0.3705473840236664,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.07610109645047389,
      "grad_norm": 0.4638019800186157,
      "learning_rate": 9.603040738500577e-06,
      "loss": 0.1041,
      "mae_dtheta": 0.01076743844896555,
      "mae_dx": 0.0022990310098975897,
      "mae_dy": 0.002343276748433709,
      "pose_mae_dtheta": 0.07315993309020996,
      "pose_mae_dx": 0.02547721564769745,
      "pose_mae_dy": 0.02948448807001114,
      "pose_rmse_dtheta": 0.19797851145267487,
      "pose_rmse_dx": 0.07402455806732178,
      "pose_rmse_dy": 0.10392844676971436,
      "pose_rmse_mean": 0.1253105103969574,
      "rmse_dtheta": 0.02478373982012272,
      "rmse_dx": 0.00726158544421196,
      "rmse_dy": 0.007226020097732544,
      "rmse_mean": 0.013090449385344982,
      "rotation_flip": 0.003234937321394682,
      "sparse_tokens": 32137.0,
      "step": 1638,
      "turn_loss": 0.09581336379051208,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35038.0,
      "epoch": 0.07614755621631666,
      "grad_norm": 0.5877228379249573,
      "learning_rate": 9.602524267262202e-06,
      "loss": 0.1604,
      "mae_dtheta": 0.028848228976130486,
      "mae_dx": 0.00837552547454834,
      "mae_dy": 0.003954654093831778,
      "pose_mae_dtheta": 0.22202301025390625,
      "pose_mae_dx": 0.0651264637708664,
      "pose_mae_dy": 0.047670330852270126,
      "pose_rmse_dtheta": 0.39047616720199585,
      "pose_rmse_dx": 0.14200612902641296,
      "pose_rmse_dy": 0.10671738535165787,
      "pose_rmse_mean": 0.21306656301021576,
      "rmse_dtheta": 0.04567032307386398,
      "rmse_dx": 0.018194304779171944,
      "rmse_dy": 0.008127269335091114,
      "rmse_mean": 0.023997299373149872,
      "rotation_flip": 0.013203613460063934,
      "sparse_tokens": 29267.0,
      "step": 1639,
      "turn_loss": 0.21134069561958313,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07619401598215945,
      "grad_norm": 0.5239108800888062,
      "learning_rate": 9.602007474166836e-06,
      "loss": 0.1403,
      "mae_dtheta": 0.012538287788629532,
      "mae_dx": 0.0033992291428148746,
      "mae_dy": 0.0027310478035360575,
      "pose_mae_dtheta": 0.08777298033237457,
      "pose_mae_dx": 0.04098791256546974,
      "pose_mae_dy": 0.03817937895655632,
      "pose_rmse_dtheta": 0.17992982268333435,
      "pose_rmse_dx": 0.1037125214934349,
      "pose_rmse_dy": 0.08001820743083954,
      "pose_rmse_mean": 0.1212201938033104,
      "rmse_dtheta": 0.02430547960102558,
      "rmse_dx": 0.010300494730472565,
      "rmse_dy": 0.00519643584266305,
      "rmse_mean": 0.01326747052371502,
      "rotation_flip": 0.004552352242171764,
      "sparse_tokens": 32073.0,
      "step": 1640,
      "turn_loss": 0.13859498500823975,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.07624047574800223,
      "grad_norm": 0.6786571741104126,
      "learning_rate": 9.601490359250616e-06,
      "loss": 0.1556,
      "mae_dtheta": 0.011045504361391068,
      "mae_dx": 0.0029002963565289974,
      "mae_dy": 0.0023138083051890135,
      "pose_mae_dtheta": 0.07170864194631577,
      "pose_mae_dx": 0.03242182731628418,
      "pose_mae_dy": 0.02802603505551815,
      "pose_rmse_dtheta": 0.14540806412696838,
      "pose_rmse_dx": 0.08240676671266556,
      "pose_rmse_dy": 0.06436450779438019,
      "pose_rmse_mean": 0.09739311784505844,
      "rmse_dtheta": 0.022668827325105667,
      "rmse_dx": 0.008153021335601807,
      "rmse_dy": 0.005608153995126486,
      "rmse_mean": 0.012143334373831749,
      "rotation_flip": 0.002838605083525181,
      "sparse_tokens": 32153.0,
      "step": 1641,
      "turn_loss": 0.10800431668758392,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.07628693551384501,
      "grad_norm": 0.3703552484512329,
      "learning_rate": 9.600972922549707e-06,
      "loss": 0.0892,
      "mae_dtheta": 0.009522765874862671,
      "mae_dx": 0.001967639196664095,
      "mae_dy": 0.0008490740437991917,
      "pose_mae_dtheta": 0.07439117878675461,
      "pose_mae_dx": 0.018246106803417206,
      "pose_mae_dy": 0.013027285225689411,
      "pose_rmse_dtheta": 0.25936272740364075,
      "pose_rmse_dx": 0.052895642817020416,
      "pose_rmse_dy": 0.06800757348537445,
      "pose_rmse_mean": 0.12675532698631287,
      "rmse_dtheta": 0.02958710305392742,
      "rmse_dx": 0.005313345696777105,
      "rmse_dy": 0.0035302573814988136,
      "rmse_mean": 0.0128102358430624,
      "rotation_flip": 0.002736726775765419,
      "sparse_tokens": 32217.0,
      "step": 1642,
      "turn_loss": 0.06690004467964172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07633339527968779,
      "grad_norm": 0.6019680500030518,
      "learning_rate": 9.600455164100291e-06,
      "loss": 0.1624,
      "mae_dtheta": 0.014362110756337643,
      "mae_dx": 0.0018735317280516028,
      "mae_dy": 0.002299512503668666,
      "pose_mae_dtheta": 0.10239460319280624,
      "pose_mae_dx": 0.025613397359848022,
      "pose_mae_dy": 0.030116572976112366,
      "pose_rmse_dtheta": 0.266760915517807,
      "pose_rmse_dx": 0.06043051928281784,
      "pose_rmse_dy": 0.07081055641174316,
      "pose_rmse_mean": 0.13266733288764954,
      "rmse_dtheta": 0.031032782047986984,
      "rmse_dx": 0.005378188565373421,
      "rmse_dy": 0.004784910473972559,
      "rmse_mean": 0.013731962069869041,
      "rotation_flip": 0.0019193857442587614,
      "sparse_tokens": 32105.0,
      "step": 1643,
      "turn_loss": 0.08664710074663162,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5225.0,
      "epoch": 0.07637985504553058,
      "grad_norm": 0.5211416482925415,
      "learning_rate": 9.599937083938577e-06,
      "loss": 0.1208,
      "mae_dtheta": 0.01989937387406826,
      "mae_dx": 0.005240731872618198,
      "mae_dy": 0.003375360043719411,
      "pose_mae_dtheta": 0.11825006455183029,
      "pose_mae_dx": 0.03142779320478439,
      "pose_mae_dy": 0.05382518097758293,
      "pose_rmse_dtheta": 0.2026171088218689,
      "pose_rmse_dx": 0.0661560669541359,
      "pose_rmse_dy": 0.11491133272647858,
      "pose_rmse_mean": 0.12789484858512878,
      "rmse_dtheta": 0.034244343638420105,
      "rmse_dx": 0.012952565215528011,
      "rmse_dy": 0.0070227994583547115,
      "rmse_mean": 0.01807323656976223,
      "rotation_flip": 0.008230452425777912,
      "sparse_tokens": 4409.0,
      "step": 1644,
      "turn_loss": 0.19744446873664856,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07642631481137335,
      "grad_norm": 0.6318296790122986,
      "learning_rate": 9.599418682100793e-06,
      "loss": 0.1133,
      "mae_dtheta": 0.012229479849338531,
      "mae_dx": 0.0031891940161585808,
      "mae_dy": 0.004757741466164589,
      "pose_mae_dtheta": 0.0846111923456192,
      "pose_mae_dx": 0.04539920389652252,
      "pose_mae_dy": 0.04269002005457878,
      "pose_rmse_dtheta": 0.17290933430194855,
      "pose_rmse_dx": 0.12750330567359924,
      "pose_rmse_dy": 0.09788239747285843,
      "pose_rmse_mean": 0.1327650249004364,
      "rmse_dtheta": 0.02353520132601261,
      "rmse_dx": 0.0076895300298929214,
      "rmse_dy": 0.010371421463787556,
      "rmse_mean": 0.01386538427323103,
      "rotation_flip": 0.006952067371457815,
      "sparse_tokens": 32105.0,
      "step": 1645,
      "turn_loss": 0.11300770193338394,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.07647277457721613,
      "grad_norm": 0.5510131120681763,
      "learning_rate": 9.598899958623192e-06,
      "loss": 0.1619,
      "mae_dtheta": 0.018872996792197227,
      "mae_dx": 0.002215592423453927,
      "mae_dy": 0.001949416589923203,
      "pose_mae_dtheta": 0.12040676921606064,
      "pose_mae_dx": 0.016605932265520096,
      "pose_mae_dy": 0.023094747215509415,
      "pose_rmse_dtheta": 0.2704489827156067,
      "pose_rmse_dx": 0.05377039685845375,
      "pose_rmse_dy": 0.044821422547101974,
      "pose_rmse_mean": 0.12301360070705414,
      "rmse_dtheta": 0.0352969691157341,
      "rmse_dx": 0.00795473251491785,
      "rmse_dy": 0.003939332906156778,
      "rmse_mean": 0.015730345621705055,
      "rotation_flip": 0.005899704992771149,
      "sparse_tokens": 5938.0,
      "step": 1646,
      "turn_loss": 0.13793285191059113,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.0765192343430589,
      "grad_norm": 0.4563859701156616,
      "learning_rate": 9.598380913542049e-06,
      "loss": 0.1122,
      "mae_dtheta": 0.012326529249548912,
      "mae_dx": 0.0019155902555212379,
      "mae_dy": 0.0021069967187941074,
      "pose_mae_dtheta": 0.08547519892454147,
      "pose_mae_dx": 0.025279611349105835,
      "pose_mae_dy": 0.03110153041779995,
      "pose_rmse_dtheta": 0.1965872198343277,
      "pose_rmse_dx": 0.06073230877518654,
      "pose_rmse_dy": 0.08163578808307648,
      "pose_rmse_mean": 0.11298511922359467,
      "rmse_dtheta": 0.02522185817360878,
      "rmse_dx": 0.005781533196568489,
      "rmse_dy": 0.004484519828110933,
      "rmse_mean": 0.01182930450886488,
      "rotation_flip": 0.005220883525907993,
      "sparse_tokens": 32105.0,
      "step": 1647,
      "turn_loss": 0.08945228159427643,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.0765656941089017,
      "grad_norm": 0.4638998210430145,
      "learning_rate": 9.597861546893658e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.037133291363716125,
      "mae_dx": 0.013771789148449898,
      "mae_dy": 0.004348035901784897,
      "pose_mae_dtheta": 0.30450791120529175,
      "pose_mae_dx": 0.12228796631097794,
      "pose_mae_dy": 0.036798786371946335,
      "pose_rmse_dtheta": 0.48862871527671814,
      "pose_rmse_dx": 0.266463965177536,
      "pose_rmse_dy": 0.08890105783939362,
      "pose_rmse_mean": 0.28133124113082886,
      "rmse_dtheta": 0.05337275192141533,
      "rmse_dx": 0.026825565844774246,
      "rmse_dy": 0.010034268721938133,
      "rmse_mean": 0.030077530071139336,
      "rotation_flip": 0.0034129691775888205,
      "sparse_tokens": 4689.0,
      "step": 1648,
      "turn_loss": 0.3184756636619568,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 23297.0,
      "epoch": 0.07661215387474447,
      "grad_norm": 0.4029569923877716,
      "learning_rate": 9.597341858714344e-06,
      "loss": 0.1111,
      "mae_dtheta": 0.0400717630982399,
      "mae_dx": 0.013914849609136581,
      "mae_dy": 0.009634796530008316,
      "pose_mae_dtheta": 0.31222042441368103,
      "pose_mae_dx": 0.12232962995767593,
      "pose_mae_dy": 0.11152879893779755,
      "pose_rmse_dtheta": 0.5047533512115479,
      "pose_rmse_dx": 0.2561855614185333,
      "pose_rmse_dy": 0.263786256313324,
      "pose_rmse_mean": 0.34157508611679077,
      "rmse_dtheta": 0.05717994645237923,
      "rmse_dx": 0.026862651109695435,
      "rmse_dy": 0.019077666103839874,
      "rmse_mean": 0.03437342122197151,
      "rotation_flip": 0.016965126618742943,
      "sparse_tokens": 18497.0,
      "step": 1649,
      "turn_loss": 0.3788858652114868,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07665861364058725,
      "grad_norm": 0.5103053450584412,
      "learning_rate": 9.596821849040446e-06,
      "loss": 0.1283,
      "mae_dtheta": 0.01519917231053114,
      "mae_dx": 0.003185827285051346,
      "mae_dy": 0.0034432723186910152,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5103051662445068,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 146.90249633789062,
      "model/head/act_norm_mean": 106.26499368686869,
      "model/head/act_norm_min": 57.33635330200195,
      "model/head/act_over_embed": 73.02629853016147,
      "model/head/grad_frac": 0.10544341057538986,
      "model/head/grad_norm": 0.053808316588401794,
      "model/head/grad_zero_frac": 0.00018274853937327862,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6865678267045454,
      "model/head/update_ratio": 0.0009350991458632052,
      "model/head/weight_delta": 4.588047981262207,
      "model/head/weight_delta_rel": 0.08048795163631439,
      "model/head/weight_norm": 57.54290008544922,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41369837522506714,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4136417884997723,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41358324885368347,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2842585096324809,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07871638238430023,
      "model/modality_embedder.encoders.pose/grad_norm": 0.040169376879930496,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5166935257847534,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013070374261587858,
      "model/modality_embedder.encoders.pose/weight_delta": 1.4782283306121826,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.04829832538962364,
      "model/modality_embedder.encoders.pose/weight_norm": 30.7331485748291,
      "model/modality_embedder/grad_frac": 0.07871638238430023,
      "model/modality_embedder/grad_norm": 0.040169376879930496,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5166935257847534,
      "model/modality_embedder/update_ratio": 0.0013070374261587858,
      "model/modality_embedder/weight_delta": 1.4782283306121826,
      "model/modality_embedder/weight_delta_rel": 0.04829832538962364,
      "model/modality_embedder/weight_norm": 30.7331485748291,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.92613220214844,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.054896685105017,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.992119789123535,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.8435408453476,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09800558537244797,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05001275613903999,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001813837792724371,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.8580130338668823,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03126651421189308,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.572893142700195,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.65978240966797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.092179232804234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.381017684936523,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.556371123318716,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08546756953001022,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04361454397439957,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014982776483520865,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.0627492666244507,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.03681446611881256,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.109786987304688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.55282592773438,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.982786696328365,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.409717559814453,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.855614272398444,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09365492314100266,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04779259115457535,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001590946689248085,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.125704050064087,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.037799034267663956,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.040348052978516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.25946807861328,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.879499358666024,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.383231163024902,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.1590529712606,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11089637875556946,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05659099668264389,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019216100918129086,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.9612941145896912,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03285247087478638,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.44978141784668,
      "model/normalizer/grad_frac": 0.40434879064559937,
      "model/normalizer/grad_norm": 0.20634128153324127,
      "model/normalizer/grad_zero_frac": 0.0001654433726798743,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0026482967659831047,
      "model/normalizer/weight_delta": 2.0630855560302734,
      "model/normalizer/weight_delta_rel": 0.026571348309516907,
      "model/normalizer/weight_norm": 77.91471099853516,
      "pose_mae_dtheta": 0.10246595740318298,
      "pose_mae_dx": 0.03882031887769699,
      "pose_mae_dy": 0.037779804319143295,
      "pose_rmse_dtheta": 0.22470688819885254,
      "pose_rmse_dx": 0.08659403026103973,
      "pose_rmse_dy": 0.08520617336034775,
      "pose_rmse_mean": 0.13216903805732727,
      "rmse_dtheta": 0.029048869386315346,
      "rmse_dx": 0.009463299065828323,
      "rmse_dy": 0.007404745556414127,
      "rmse_mean": 0.015305638313293457,
      "rotation_flip": 0.005384063348174095,
      "sparse_tokens": 32105.0,
      "step": 1650,
      "turn_loss": 0.1416890174150467,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.07670507340643003,
      "grad_norm": 0.7770305871963501,
      "learning_rate": 9.596301517908329e-06,
      "loss": 0.1944,
      "mae_dtheta": 0.04284060373902321,
      "mae_dx": 0.015379074029624462,
      "mae_dy": 0.009382362477481365,
      "pose_mae_dtheta": 0.359738290309906,
      "pose_mae_dx": 0.1376592367887497,
      "pose_mae_dy": 0.10033826529979706,
      "pose_rmse_dtheta": 0.6588114500045776,
      "pose_rmse_dx": 0.2730425298213959,
      "pose_rmse_dy": 0.22972799837589264,
      "pose_rmse_mean": 0.3871940076351166,
      "rmse_dtheta": 0.06491898000240326,
      "rmse_dx": 0.026949092745780945,
      "rmse_dy": 0.020884841680526733,
      "rmse_mean": 0.03758430480957031,
      "rotation_flip": 0.008547008968889713,
      "sparse_tokens": 13519.0,
      "step": 1651,
      "turn_loss": 0.44031357765197754,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.07675153317227282,
      "grad_norm": 0.6762710213661194,
      "learning_rate": 9.595780865354379e-06,
      "loss": 0.111,
      "mae_dtheta": 0.03448088467121124,
      "mae_dx": 0.0034230768214911222,
      "mae_dy": 0.004480899311602116,
      "pose_mae_dtheta": 0.1851387321949005,
      "pose_mae_dx": 0.02081463299691677,
      "pose_mae_dy": 0.06711389869451523,
      "pose_rmse_dtheta": 0.422298401594162,
      "pose_rmse_dx": 0.047215837985277176,
      "pose_rmse_dy": 0.1313171535730362,
      "pose_rmse_mean": 0.20027713477611542,
      "rmse_dtheta": 0.05476381629705429,
      "rmse_dx": 0.00739324651658535,
      "rmse_dy": 0.008502288721501827,
      "rmse_mean": 0.023553118109703064,
      "rotation_flip": 0.007194244768470526,
      "sparse_tokens": 2258.0,
      "step": 1652,
      "turn_loss": 0.26080018281936646,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.0767979929381156,
      "grad_norm": 0.4770830571651459,
      "learning_rate": 9.595259891415008e-06,
      "loss": 0.1567,
      "mae_dtheta": 0.012521079741418362,
      "mae_dx": 0.002289572963491082,
      "mae_dy": 0.0031179841607809067,
      "pose_mae_dtheta": 0.0845988392829895,
      "pose_mae_dx": 0.02780667506158352,
      "pose_mae_dy": 0.03199465945363045,
      "pose_rmse_dtheta": 0.16093698143959045,
      "pose_rmse_dx": 0.0656006932258606,
      "pose_rmse_dy": 0.06810325384140015,
      "pose_rmse_mean": 0.09821364283561707,
      "rmse_dtheta": 0.023450806736946106,
      "rmse_dx": 0.0063032712787389755,
      "rmse_dy": 0.007295401766896248,
      "rmse_mean": 0.012349827215075493,
      "rotation_flip": 0.003043625270947814,
      "sparse_tokens": 32153.0,
      "step": 1653,
      "turn_loss": 0.10963805019855499,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07684445270395837,
      "grad_norm": 0.4311901032924652,
      "learning_rate": 9.594738596126644e-06,
      "loss": 0.1492,
      "mae_dtheta": 0.013321110047399998,
      "mae_dx": 0.0020840803626924753,
      "mae_dy": 0.0029225554317235947,
      "pose_mae_dtheta": 0.093001589179039,
      "pose_mae_dx": 0.0321757048368454,
      "pose_mae_dy": 0.038079164922237396,
      "pose_rmse_dtheta": 0.2264539748430252,
      "pose_rmse_dx": 0.07753945142030716,
      "pose_rmse_dy": 0.1143064871430397,
      "pose_rmse_mean": 0.13943330943584442,
      "rmse_dtheta": 0.02657266892492771,
      "rmse_dx": 0.006019443739205599,
      "rmse_dy": 0.006554340943694115,
      "rmse_mean": 0.013048818334937096,
      "rotation_flip": 0.003370786551386118,
      "sparse_tokens": 32121.0,
      "step": 1654,
      "turn_loss": 0.09931106120347977,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.07689091246980115,
      "grad_norm": 0.3999805152416229,
      "learning_rate": 9.594216979525745e-06,
      "loss": 0.0865,
      "mae_dtheta": 0.00713138235732913,
      "mae_dx": 0.00122693064622581,
      "mae_dy": 0.0014364994131028652,
      "pose_mae_dtheta": 0.05114731192588806,
      "pose_mae_dx": 0.017522798851132393,
      "pose_mae_dy": 0.022791974246501923,
      "pose_rmse_dtheta": 0.12030865252017975,
      "pose_rmse_dx": 0.046699631959199905,
      "pose_rmse_dy": 0.05684095621109009,
      "pose_rmse_mean": 0.07461641728878021,
      "rmse_dtheta": 0.016896499320864677,
      "rmse_dx": 0.004284291062504053,
      "rmse_dy": 0.0030868484172970057,
      "rmse_mean": 0.008089212700724602,
      "rotation_flip": 0.0028376844711601734,
      "sparse_tokens": 32057.0,
      "step": 1655,
      "turn_loss": 0.06255540996789932,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13929.0,
      "epoch": 0.07693737223564394,
      "grad_norm": 0.46530091762542725,
      "learning_rate": 9.593695041648787e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.036157622933387756,
      "mae_dx": 0.012450169771909714,
      "mae_dy": 0.007059955038130283,
      "pose_mae_dtheta": 0.2830096483230591,
      "pose_mae_dx": 0.09085430949926376,
      "pose_mae_dy": 0.09696327894926071,
      "pose_rmse_dtheta": 0.4644460678100586,
      "pose_rmse_dx": 0.2017553746700287,
      "pose_rmse_dy": 0.18141677975654602,
      "pose_rmse_mean": 0.282539427280426,
      "rmse_dtheta": 0.05076265335083008,
      "rmse_dx": 0.024982890114188194,
      "rmse_dy": 0.012001020833849907,
      "rmse_mean": 0.029248856008052826,
      "rotation_flip": 0.01990811713039875,
      "sparse_tokens": 11538.0,
      "step": 1656,
      "turn_loss": 0.3033502697944641,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.07698383200148672,
      "grad_norm": 0.7836693525314331,
      "learning_rate": 9.59317278253227e-06,
      "loss": 0.1558,
      "mae_dtheta": 0.03596390038728714,
      "mae_dx": 0.015570585615932941,
      "mae_dy": 0.005379293579608202,
      "pose_mae_dtheta": 0.29346588253974915,
      "pose_mae_dx": 0.12038812041282654,
      "pose_mae_dy": 0.07131990790367126,
      "pose_rmse_dtheta": 0.5291406512260437,
      "pose_rmse_dx": 0.25145968794822693,
      "pose_rmse_dy": 0.14701654016971588,
      "pose_rmse_mean": 0.3092056214809418,
      "rmse_dtheta": 0.05479629710316658,
      "rmse_dx": 0.029277430847287178,
      "rmse_dy": 0.011842159554362297,
      "rmse_mean": 0.03197196498513222,
      "rotation_flip": 0.006802720949053764,
      "sparse_tokens": 10684.0,
      "step": 1657,
      "turn_loss": 0.2624174952507019,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.07703029176732949,
      "grad_norm": 1.0743130445480347,
      "learning_rate": 9.592650202212713e-06,
      "loss": 0.2322,
      "mae_dtheta": 0.02947055920958519,
      "mae_dx": 0.011566156521439552,
      "mae_dy": 0.004775156266987324,
      "pose_mae_dtheta": 0.25183722376823425,
      "pose_mae_dx": 0.08529950678348541,
      "pose_mae_dy": 0.056989967823028564,
      "pose_rmse_dtheta": 0.49776706099510193,
      "pose_rmse_dx": 0.2111991047859192,
      "pose_rmse_dy": 0.11731783300638199,
      "pose_rmse_mean": 0.27542799711227417,
      "rmse_dtheta": 0.04832218587398529,
      "rmse_dx": 0.025565151125192642,
      "rmse_dy": 0.008302057161927223,
      "rmse_mean": 0.027396462857723236,
      "rotation_flip": 0.017985612154006958,
      "sparse_tokens": 4531.0,
      "step": 1658,
      "turn_loss": 0.19533443450927734,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.07707675153317227,
      "grad_norm": 0.8142136931419373,
      "learning_rate": 9.59212730072666e-06,
      "loss": 0.189,
      "mae_dtheta": 0.03522583097219467,
      "mae_dx": 0.007599453441798687,
      "mae_dy": 0.003990887198597193,
      "pose_mae_dtheta": 0.2866557240486145,
      "pose_mae_dx": 0.07315558940172195,
      "pose_mae_dy": 0.023852968588471413,
      "pose_rmse_dtheta": 0.5582915544509888,
      "pose_rmse_dx": 0.21655872464179993,
      "pose_rmse_dy": 0.07921968400478363,
      "pose_rmse_mean": 0.2846899926662445,
      "rmse_dtheta": 0.05812229961156845,
      "rmse_dx": 0.018999969586730003,
      "rmse_dy": 0.013257456943392754,
      "rmse_mean": 0.030126577243208885,
      "rotation_flip": 0.002475247485563159,
      "sparse_tokens": 6133.0,
      "step": 1659,
      "turn_loss": 0.2723122537136078,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07712321129901506,
      "grad_norm": 0.5838342905044556,
      "learning_rate": 9.591604078110686e-06,
      "loss": 0.0824,
      "mae_dtheta": 0.009965145960450172,
      "mae_dx": 0.0017436021007597446,
      "mae_dy": 0.001857696333900094,
      "pose_mae_dtheta": 0.06903223693370819,
      "pose_mae_dx": 0.021452125161886215,
      "pose_mae_dy": 0.02416199818253517,
      "pose_rmse_dtheta": 0.16705891489982605,
      "pose_rmse_dx": 0.05376014485955238,
      "pose_rmse_dy": 0.06035779416561127,
      "pose_rmse_mean": 0.09372562170028687,
      "rmse_dtheta": 0.022262737154960632,
      "rmse_dx": 0.005150310695171356,
      "rmse_dy": 0.004453365691006184,
      "rmse_mean": 0.010622138157486916,
      "rotation_flip": 0.002972399117425084,
      "sparse_tokens": 32121.0,
      "step": 1660,
      "turn_loss": 0.07525476813316345,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.07716967106485784,
      "grad_norm": 0.671870231628418,
      "learning_rate": 9.591080534401371e-06,
      "loss": 0.1665,
      "mae_dtheta": 0.04057968035340309,
      "mae_dx": 0.013807937502861023,
      "mae_dy": 0.004072244744747877,
      "pose_mae_dtheta": 0.3433586359024048,
      "pose_mae_dx": 0.10943504422903061,
      "pose_mae_dy": 0.044869136065244675,
      "pose_rmse_dtheta": 0.5784081816673279,
      "pose_rmse_dx": 0.23518581688404083,
      "pose_rmse_dy": 0.105957992374897,
      "pose_rmse_mean": 0.3065173327922821,
      "rmse_dtheta": 0.05887031555175781,
      "rmse_dx": 0.026127412915229797,
      "rmse_dy": 0.007975910790264606,
      "rmse_mean": 0.030991215258836746,
      "rotation_flip": 0.009727626107633114,
      "sparse_tokens": 9827.0,
      "step": 1661,
      "turn_loss": 0.23583772778511047,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.07721613083070061,
      "grad_norm": 0.6485072374343872,
      "learning_rate": 9.590556669635331e-06,
      "loss": 0.1854,
      "mae_dtheta": 0.03966075927019119,
      "mae_dx": 0.009297781623899937,
      "mae_dy": 0.003782544983550906,
      "pose_mae_dtheta": 0.2871094048023224,
      "pose_mae_dx": 0.06679823994636536,
      "pose_mae_dy": 0.041542332619428635,
      "pose_rmse_dtheta": 0.5641276240348816,
      "pose_rmse_dx": 0.1594647467136383,
      "pose_rmse_dy": 0.0964079350233078,
      "pose_rmse_mean": 0.27333346009254456,
      "rmse_dtheta": 0.0628424733877182,
      "rmse_dx": 0.02035755291581154,
      "rmse_dy": 0.00795100349932909,
      "rmse_mean": 0.030383676290512085,
      "rotation_flip": 0.0026845638640224934,
      "sparse_tokens": 12456.0,
      "step": 1662,
      "turn_loss": 0.2563066780567169,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.07726259059654339,
      "grad_norm": 0.6216332316398621,
      "learning_rate": 9.5900324838492e-06,
      "loss": 0.1604,
      "mae_dtheta": 0.037417374551296234,
      "mae_dx": 0.013332747854292393,
      "mae_dy": 0.00730937859043479,
      "pose_mae_dtheta": 0.30697762966156006,
      "pose_mae_dx": 0.10300789028406143,
      "pose_mae_dy": 0.07776009291410446,
      "pose_rmse_dtheta": 0.498870849609375,
      "pose_rmse_dx": 0.21334365010261536,
      "pose_rmse_dy": 0.1694754660129547,
      "pose_rmse_mean": 0.2938966453075409,
      "rmse_dtheta": 0.05294395983219147,
      "rmse_dx": 0.02520027384161949,
      "rmse_dy": 0.014357179403305054,
      "rmse_mean": 0.030833806842565536,
      "rotation_flip": 0.017438365146517754,
      "sparse_tokens": 26788.0,
      "step": 1663,
      "turn_loss": 0.29769372940063477,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 18183.0,
      "epoch": 0.07730905036238617,
      "grad_norm": 0.48832541704177856,
      "learning_rate": 9.589507977079631e-06,
      "loss": 0.1497,
      "mae_dtheta": 0.03176100552082062,
      "mae_dx": 0.010098369792103767,
      "mae_dy": 0.004310201853513718,
      "pose_mae_dtheta": 0.2528592348098755,
      "pose_mae_dx": 0.0845823585987091,
      "pose_mae_dy": 0.05671099200844765,
      "pose_rmse_dtheta": 0.43545031547546387,
      "pose_rmse_dx": 0.18984897434711456,
      "pose_rmse_dy": 0.12014856189489365,
      "pose_rmse_mean": 0.2484826147556305,
      "rmse_dtheta": 0.04950438812375069,
      "rmse_dx": 0.021611863747239113,
      "rmse_dy": 0.008551768958568573,
      "rmse_mean": 0.02655600756406784,
      "rotation_flip": 0.012263099662959576,
      "sparse_tokens": 14764.0,
      "step": 1664,
      "turn_loss": 0.2860265076160431,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.07735551012822896,
      "grad_norm": 0.54184889793396,
      "learning_rate": 9.588983149363307e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.016911806538701057,
      "mae_dx": 0.004121189936995506,
      "mae_dy": 0.003846356412395835,
      "pose_mae_dtheta": 0.12049305438995361,
      "pose_mae_dx": 0.03858878090977669,
      "pose_mae_dy": 0.06008889898657799,
      "pose_rmse_dtheta": 0.22507032752037048,
      "pose_rmse_dx": 0.09555840492248535,
      "pose_rmse_dy": 0.13506580889225006,
      "pose_rmse_mean": 0.15189819037914276,
      "rmse_dtheta": 0.031397417187690735,
      "rmse_dx": 0.012853660620748997,
      "rmse_dy": 0.007655110210180283,
      "rmse_mean": 0.01730206236243248,
      "rotation_flip": 0.009771986864507198,
      "sparse_tokens": 14615.0,
      "step": 1665,
      "turn_loss": 0.12500804662704468,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.07740196989407173,
      "grad_norm": 0.5233743190765381,
      "learning_rate": 9.588458000736929e-06,
      "loss": 0.116,
      "mae_dtheta": 0.011108753271400928,
      "mae_dx": 0.002654722426086664,
      "mae_dy": 0.002327354159206152,
      "pose_mae_dtheta": 0.08115006983280182,
      "pose_mae_dx": 0.03148098662495613,
      "pose_mae_dy": 0.0288775023072958,
      "pose_rmse_dtheta": 0.18061023950576782,
      "pose_rmse_dx": 0.07351784408092499,
      "pose_rmse_dy": 0.06083610653877258,
      "pose_rmse_mean": 0.10498806834220886,
      "rmse_dtheta": 0.02371673844754696,
      "rmse_dx": 0.007637613918632269,
      "rmse_dy": 0.004644020926207304,
      "rmse_mean": 0.011999458074569702,
      "rotation_flip": 0.00372856087051332,
      "sparse_tokens": 32137.0,
      "step": 1666,
      "turn_loss": 0.09735741466283798,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.07744842965991451,
      "grad_norm": 0.6402994394302368,
      "learning_rate": 9.58793253123722e-06,
      "loss": 0.1436,
      "mae_dtheta": 0.0327848345041275,
      "mae_dx": 0.009476742707192898,
      "mae_dy": 0.005976601038128138,
      "pose_mae_dtheta": 0.2671549916267395,
      "pose_mae_dx": 0.07709857076406479,
      "pose_mae_dy": 0.09208076447248459,
      "pose_rmse_dtheta": 0.48390135169029236,
      "pose_rmse_dx": 0.18865343928337097,
      "pose_rmse_dy": 0.22860939800739288,
      "pose_rmse_mean": 0.30038806796073914,
      "rmse_dtheta": 0.05152103677392006,
      "rmse_dx": 0.02197197452187538,
      "rmse_dy": 0.012290488928556442,
      "rmse_mean": 0.028594499453902245,
      "rotation_flip": 0.012884752824902534,
      "sparse_tokens": 26716.0,
      "step": 1667,
      "turn_loss": 0.23067651689052582,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07749488942575729,
      "grad_norm": 0.6606622934341431,
      "learning_rate": 9.587406740900926e-06,
      "loss": 0.1732,
      "mae_dtheta": 0.012386780232191086,
      "mae_dx": 0.002108197659254074,
      "mae_dy": 0.0035290212836116552,
      "pose_mae_dtheta": 0.08684157580137253,
      "pose_mae_dx": 0.036179885268211365,
      "pose_mae_dy": 0.04007749259471893,
      "pose_rmse_dtheta": 0.22948665916919708,
      "pose_rmse_dx": 0.11420903354883194,
      "pose_rmse_dy": 0.1133788675069809,
      "pose_rmse_mean": 0.15235820412635803,
      "rmse_dtheta": 0.02709806151688099,
      "rmse_dx": 0.005843542981892824,
      "rmse_dy": 0.009017929434776306,
      "rmse_mean": 0.013986512087285519,
      "rotation_flip": 0.006941608618944883,
      "sparse_tokens": 32073.0,
      "step": 1668,
      "turn_loss": 0.09834682941436768,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.07754134919160008,
      "grad_norm": 0.6106743216514587,
      "learning_rate": 9.586880629764817e-06,
      "loss": 0.1872,
      "mae_dtheta": 0.042601946741342545,
      "mae_dx": 0.01161354873329401,
      "mae_dy": 0.0029330416582524776,
      "pose_mae_dtheta": 0.3601481020450592,
      "pose_mae_dx": 0.10300878435373306,
      "pose_mae_dy": 0.0336732380092144,
      "pose_rmse_dtheta": 0.5742416381835938,
      "pose_rmse_dx": 0.2219221442937851,
      "pose_rmse_dy": 0.08601026237010956,
      "pose_rmse_mean": 0.29405802488327026,
      "rmse_dtheta": 0.060495443642139435,
      "rmse_dx": 0.024250993505120277,
      "rmse_dy": 0.006488153710961342,
      "rmse_mean": 0.030411530286073685,
      "rotation_flip": 0.01165048498660326,
      "sparse_tokens": 8263.0,
      "step": 1669,
      "turn_loss": 0.34554988145828247,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.07758780895744286,
      "grad_norm": 0.6676384806632996,
      "learning_rate": 9.586354197865685e-06,
      "loss": 0.133,
      "mae_dtheta": 0.04385069012641907,
      "mae_dx": 0.011292955838143826,
      "mae_dy": 0.008054218254983425,
      "pose_mae_dtheta": 0.39083582162857056,
      "pose_mae_dx": 0.08383100479841232,
      "pose_mae_dy": 0.09155203402042389,
      "pose_rmse_dtheta": 0.6844758987426758,
      "pose_rmse_dx": 0.20358753204345703,
      "pose_rmse_dy": 0.22613497078418732,
      "pose_rmse_mean": 0.37139949202537537,
      "rmse_dtheta": 0.06697411090135574,
      "rmse_dx": 0.024394391104578972,
      "rmse_dy": 0.019328448921442032,
      "rmse_mean": 0.036898985505104065,
      "rotation_flip": 0.011080332100391388,
      "sparse_tokens": 7304.0,
      "step": 1670,
      "turn_loss": 0.3426594138145447,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.07763426872328563,
      "grad_norm": 0.7119865417480469,
      "learning_rate": 9.58582744524034e-06,
      "loss": 0.1742,
      "mae_dtheta": 0.0341549888253212,
      "mae_dx": 0.005390366539359093,
      "mae_dy": 0.0070863026194274426,
      "pose_mae_dtheta": 0.2336673140525818,
      "pose_mae_dx": 0.04488389194011688,
      "pose_mae_dy": 0.07161478698253632,
      "pose_rmse_dtheta": 0.449911504983902,
      "pose_rmse_dx": 0.07593157142400742,
      "pose_rmse_dy": 0.1456899642944336,
      "pose_rmse_mean": 0.22384434938430786,
      "rmse_dtheta": 0.05404357612133026,
      "rmse_dx": 0.012554925866425037,
      "rmse_dy": 0.011816089041531086,
      "rmse_mean": 0.026138199493288994,
      "rotation_flip": 0.017421603202819824,
      "sparse_tokens": 5916.0,
      "step": 1671,
      "turn_loss": 0.3005163073539734,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07768072848912841,
      "grad_norm": 0.8286083340644836,
      "learning_rate": 9.58530037192562e-06,
      "loss": 0.2044,
      "mae_dtheta": 0.013007371686398983,
      "mae_dx": 0.002193246968090534,
      "mae_dy": 0.002309516305103898,
      "pose_mae_dtheta": 0.08715111017227173,
      "pose_mae_dx": 0.027105987071990967,
      "pose_mae_dy": 0.03152161464095116,
      "pose_rmse_dtheta": 0.20310048758983612,
      "pose_rmse_dx": 0.0649687796831131,
      "pose_rmse_dy": 0.08745168149471283,
      "pose_rmse_mean": 0.11850699037313461,
      "rmse_dtheta": 0.026701971888542175,
      "rmse_dx": 0.006079410202801228,
      "rmse_dy": 0.0056432439014315605,
      "rmse_mean": 0.012808209285140038,
      "rotation_flip": 0.005997600965201855,
      "sparse_tokens": 32121.0,
      "step": 1672,
      "turn_loss": 0.09760935604572296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0777271882549712,
      "grad_norm": 1.1081656217575073,
      "learning_rate": 9.584772977958386e-06,
      "loss": 0.184,
      "mae_dtheta": 0.015122346580028534,
      "mae_dx": 0.003291627625003457,
      "mae_dy": 0.003969128243625164,
      "pose_mae_dtheta": 0.10784178227186203,
      "pose_mae_dx": 0.04543758183717728,
      "pose_mae_dy": 0.04467353969812393,
      "pose_rmse_dtheta": 0.23521974682807922,
      "pose_rmse_dx": 0.12158282846212387,
      "pose_rmse_dy": 0.1048257127404213,
      "pose_rmse_mean": 0.15387609601020813,
      "rmse_dtheta": 0.028906231746077538,
      "rmse_dx": 0.009042383171617985,
      "rmse_dy": 0.010601725429296494,
      "rmse_mean": 0.01618344709277153,
      "rotation_flip": 0.009031792171299458,
      "sparse_tokens": 32089.0,
      "step": 1673,
      "turn_loss": 0.13348156213760376,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10698.0,
      "epoch": 0.07777364802081398,
      "grad_norm": 0.6121608018875122,
      "learning_rate": 9.584245263375515e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.023425649851560593,
      "mae_dx": 0.009677167050540447,
      "mae_dy": 0.0014828166458755732,
      "pose_mae_dtheta": 0.19144296646118164,
      "pose_mae_dx": 0.07355279475450516,
      "pose_mae_dy": 0.017129698768258095,
      "pose_rmse_dtheta": 0.39485403895378113,
      "pose_rmse_dx": 0.20505082607269287,
      "pose_rmse_dy": 0.04638868197798729,
      "pose_rmse_mean": 0.21543119847774506,
      "rmse_dtheta": 0.04363666847348213,
      "rmse_dx": 0.022620363160967827,
      "rmse_dy": 0.0034836167469620705,
      "rmse_mean": 0.02324688248336315,
      "rotation_flip": 0.02463054098188877,
      "sparse_tokens": 8170.0,
      "step": 1674,
      "turn_loss": 0.1908036470413208,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07782010778665675,
      "grad_norm": 0.3965732157230377,
      "learning_rate": 9.583717228213914e-06,
      "loss": 0.1136,
      "mae_dtheta": 0.011671205051243305,
      "mae_dx": 0.0022053306456655264,
      "mae_dy": 0.0033144166227430105,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.39657315611839294,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.5400848388672,
      "model/head/act_norm_mean": 112.69982047032828,
      "model/head/act_norm_min": 63.20927047729492,
      "model/head/act_over_embed": 77.4483717395524,
      "model/head/grad_frac": 0.11908449232578278,
      "model/head/grad_norm": 0.0472257137298584,
      "model/head/grad_zero_frac": 0.00019766030891332775,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6854630287247475,
      "model/head/update_ratio": 0.0008205817430280149,
      "model/head/weight_delta": 4.626673221588135,
      "model/head/weight_delta_rel": 0.08116555213928223,
      "model/head/weight_norm": 57.55150604248047,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4138084352016449,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4137296804932735,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41366446018218994,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28431890983327274,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08893018215894699,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03526732325553894,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5235163256726457,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011474371422082186,
      "model/modality_embedder.encoders.pose/weight_delta": 1.4954458475112915,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.04886087775230408,
      "model/modality_embedder.encoders.pose/weight_norm": 30.735734939575195,
      "model/modality_embedder/grad_frac": 0.08893018215894699,
      "model/modality_embedder/grad_norm": 0.03526732325553894,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5235163256726457,
      "model/modality_embedder/update_ratio": 0.0011474371422082186,
      "model/modality_embedder/weight_delta": 1.4954458475112915,
      "model/modality_embedder/weight_delta_rel": 0.04886087775230408,
      "model/modality_embedder/weight_norm": 30.735734939575195,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.595703125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.683669532627867,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.98788833618164,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.275639432829447,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08861580491065979,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.035142648965120316,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001274409587495029,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.8688437938690186,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03166119381785393,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.57563018798828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.09994506835938,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.74606180856181,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.146799087524414,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.005725351124447,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08866856247186661,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03516357019543648,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012077628634870052,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.0778794288635254,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.037338584661483765,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.11463165283203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.79014587402344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.719569203944204,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.230603218078613,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.361938109498563,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09345019608736038,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03705983981490135,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012334759812802076,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.1421546936035156,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.03835141658782959,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.0450439453125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.25039672851562,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.648408690075357,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.357522964477539,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.68745466244767,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12501731514930725,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04957851022481918,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016833062982186675,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.9732885360717773,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.033262383192777634,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.453052520751953,
      "model/normalizer/grad_frac": 0.5066503286361694,
      "model/normalizer/grad_norm": 0.20092391967773438,
      "model/normalizer/grad_zero_frac": 0.00016662511916365474,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002578594721853733,
      "model/normalizer/weight_delta": 2.0911662578582764,
      "model/normalizer/weight_delta_rel": 0.026933010667562485,
      "model/normalizer/weight_norm": 77.91992950439453,
      "pose_mae_dtheta": 0.07841175049543381,
      "pose_mae_dx": 0.030688732862472534,
      "pose_mae_dy": 0.036489345133304596,
      "pose_rmse_dtheta": 0.18784020841121674,
      "pose_rmse_dx": 0.07328087836503983,
      "pose_rmse_dy": 0.08432703465223312,
      "pose_rmse_mean": 0.11514937877655029,
      "rmse_dtheta": 0.02387245185673237,
      "rmse_dx": 0.0062325261533260345,
      "rmse_dy": 0.006414327304810286,
      "rmse_mean": 0.012173101305961609,
      "rotation_flip": 0.0015360983088612556,
      "sparse_tokens": 32105.0,
      "step": 1675,
      "turn_loss": 0.10134429484605789,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.07786656755249953,
      "grad_norm": 0.6828218698501587,
      "learning_rate": 9.583188872510508e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.030559273436665535,
      "mae_dx": 0.011449755169451237,
      "mae_dy": 0.0027244798839092255,
      "pose_mae_dtheta": 0.23755447566509247,
      "pose_mae_dx": 0.10267238318920135,
      "pose_mae_dy": 0.03348998725414276,
      "pose_rmse_dtheta": 0.4035739302635193,
      "pose_rmse_dx": 0.23409032821655273,
      "pose_rmse_dy": 0.0674600750207901,
      "pose_rmse_mean": 0.23504143953323364,
      "rmse_dtheta": 0.04623129591345787,
      "rmse_dx": 0.022912103682756424,
      "rmse_dy": 0.006878846790641546,
      "rmse_mean": 0.025340748950839043,
      "rotation_flip": 0.009756097570061684,
      "sparse_tokens": 7129.0,
      "step": 1676,
      "turn_loss": 0.17576687037944794,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.07791302731834232,
      "grad_norm": 0.5961313247680664,
      "learning_rate": 9.58266019630224e-06,
      "loss": 0.1406,
      "mae_dtheta": 0.03709347918629646,
      "mae_dx": 0.01563049666583538,
      "mae_dy": 0.006395682226866484,
      "pose_mae_dtheta": 0.3149234652519226,
      "pose_mae_dx": 0.1358177214860916,
      "pose_mae_dy": 0.0916852131485939,
      "pose_rmse_dtheta": 0.5282783508300781,
      "pose_rmse_dx": 0.27635306119918823,
      "pose_rmse_dy": 0.20503903925418854,
      "pose_rmse_mean": 0.3365568518638611,
      "rmse_dtheta": 0.052949052304029465,
      "rmse_dx": 0.02910088188946247,
      "rmse_dy": 0.012548810802400112,
      "rmse_mean": 0.03153291717171669,
      "rotation_flip": 0.008571428246796131,
      "sparse_tokens": 13326.0,
      "step": 1677,
      "turn_loss": 0.3544548749923706,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.0779594870841851,
      "grad_norm": 0.9904393553733826,
      "learning_rate": 9.582131199626088e-06,
      "loss": 0.282,
      "mae_dtheta": 0.03265973553061485,
      "mae_dx": 0.006884814240038395,
      "mae_dy": 0.005106945987790823,
      "pose_mae_dtheta": 0.25821322202682495,
      "pose_mae_dx": 0.05038265511393547,
      "pose_mae_dy": 0.06404826045036316,
      "pose_rmse_dtheta": 0.4625765085220337,
      "pose_rmse_dx": 0.11802466213703156,
      "pose_rmse_dy": 0.13779547810554504,
      "pose_rmse_mean": 0.23946556448936462,
      "rmse_dtheta": 0.049334969371557236,
      "rmse_dx": 0.017340969294309616,
      "rmse_dy": 0.009258942678570747,
      "rmse_mean": 0.025311626493930817,
      "rotation_flip": 0.013677811250090599,
      "sparse_tokens": 11992.0,
      "step": 1678,
      "turn_loss": 0.24521242082118988,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 30497.0,
      "epoch": 0.07800594685002787,
      "grad_norm": 0.6211735010147095,
      "learning_rate": 9.581601882519041e-06,
      "loss": 0.2088,
      "mae_dtheta": 0.033802710473537445,
      "mae_dx": 0.011919857002794743,
      "mae_dy": 0.005809989757835865,
      "pose_mae_dtheta": 0.2512744069099426,
      "pose_mae_dx": 0.09146857261657715,
      "pose_mae_dy": 0.06260203570127487,
      "pose_rmse_dtheta": 0.43271705508232117,
      "pose_rmse_dx": 0.19752559065818787,
      "pose_rmse_dy": 0.13263088464736938,
      "pose_rmse_mean": 0.2542911767959595,
      "rmse_dtheta": 0.05188009887933731,
      "rmse_dx": 0.02380532957613468,
      "rmse_dy": 0.011038336902856827,
      "rmse_mean": 0.02890792116522789,
      "rotation_flip": 0.014208389446139336,
      "sparse_tokens": 23274.0,
      "step": 1679,
      "turn_loss": 0.31545183062553406,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.07805240661587065,
      "grad_norm": 0.6582881212234497,
      "learning_rate": 9.581072245018114e-06,
      "loss": 0.1265,
      "mae_dtheta": 0.030649930238723755,
      "mae_dx": 0.01327598374336958,
      "mae_dy": 0.0026662577874958515,
      "pose_mae_dtheta": 0.22614046931266785,
      "pose_mae_dx": 0.10800543427467346,
      "pose_mae_dy": 0.02975143864750862,
      "pose_rmse_dtheta": 0.3987801969051361,
      "pose_rmse_dx": 0.24788956344127655,
      "pose_rmse_dy": 0.07682294398546219,
      "pose_rmse_mean": 0.24116423726081848,
      "rmse_dtheta": 0.0469314381480217,
      "rmse_dx": 0.026462603360414505,
      "rmse_dy": 0.005519210360944271,
      "rmse_mean": 0.026304420083761215,
      "rotation_flip": 0.01678108237683773,
      "sparse_tokens": 21939.0,
      "step": 1680,
      "turn_loss": 0.22362813353538513,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.07809886638171344,
      "grad_norm": 0.7424339056015015,
      "learning_rate": 9.580542287160348e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.008645386435091496,
      "mae_dx": 0.0023495738860219717,
      "mae_dy": 0.00044261047150939703,
      "pose_mae_dtheta": 0.05991203710436821,
      "pose_mae_dx": 0.01903318241238594,
      "pose_mae_dy": 0.006423161830753088,
      "pose_rmse_dtheta": 0.2140481323003769,
      "pose_rmse_dx": 0.04374038055539131,
      "pose_rmse_dy": 0.01520070806145668,
      "pose_rmse_mean": 0.0909964069724083,
      "rmse_dtheta": 0.028626034036278725,
      "rmse_dx": 0.005815460812300444,
      "rmse_dy": 0.0007758183055557311,
      "rmse_mean": 0.011739104054868221,
      "rotation_flip": 0.0022246940061450005,
      "sparse_tokens": 32249.0,
      "step": 1681,
      "turn_loss": 0.06199803575873375,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.07814532614755622,
      "grad_norm": 0.7697224020957947,
      "learning_rate": 9.580012008982802e-06,
      "loss": 0.1632,
      "mae_dtheta": 0.012475247494876385,
      "mae_dx": 0.0025157358031719923,
      "mae_dy": 0.002650200156494975,
      "pose_mae_dtheta": 0.09089545160531998,
      "pose_mae_dx": 0.032418228685855865,
      "pose_mae_dy": 0.031010117381811142,
      "pose_rmse_dtheta": 0.18140654265880585,
      "pose_rmse_dx": 0.07362877577543259,
      "pose_rmse_dy": 0.0722898319363594,
      "pose_rmse_mean": 0.10910838097333908,
      "rmse_dtheta": 0.02425909973680973,
      "rmse_dx": 0.006666250992566347,
      "rmse_dy": 0.005579037591814995,
      "rmse_mean": 0.012168129906058311,
      "rotation_flip": 0.00476016104221344,
      "sparse_tokens": 32201.0,
      "step": 1682,
      "turn_loss": 0.10706491023302078,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.078191785913399,
      "grad_norm": 0.5519391298294067,
      "learning_rate": 9.579481410522556e-06,
      "loss": 0.1701,
      "mae_dtheta": 0.008275988511741161,
      "mae_dx": 0.0016657257219776511,
      "mae_dy": 0.0027779066003859043,
      "pose_mae_dtheta": 0.06427785009145737,
      "pose_mae_dx": 0.025286857038736343,
      "pose_mae_dy": 0.032060038298368454,
      "pose_rmse_dtheta": 0.17005884647369385,
      "pose_rmse_dx": 0.08666995912790298,
      "pose_rmse_dy": 0.08737756311893463,
      "pose_rmse_mean": 0.11470212787389755,
      "rmse_dtheta": 0.019984688609838486,
      "rmse_dx": 0.0049472348764538765,
      "rmse_dy": 0.00703760702162981,
      "rmse_mean": 0.010656509548425674,
      "rotation_flip": 0.0053734551183879375,
      "sparse_tokens": 32057.0,
      "step": 1683,
      "turn_loss": 0.07085324823856354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.07823824567924177,
      "grad_norm": 0.5757964253425598,
      "learning_rate": 9.578950491816719e-06,
      "loss": 0.1179,
      "mae_dtheta": 0.01357896439731121,
      "mae_dx": 0.003283355850726366,
      "mae_dy": 0.0036875098012387753,
      "pose_mae_dtheta": 0.0964609757065773,
      "pose_mae_dx": 0.038564689457416534,
      "pose_mae_dy": 0.03785032406449318,
      "pose_rmse_dtheta": 0.19473372399806976,
      "pose_rmse_dx": 0.09497138112783432,
      "pose_rmse_dy": 0.08285772055387497,
      "pose_rmse_mean": 0.12418761104345322,
      "rmse_dtheta": 0.026475805789232254,
      "rmse_dx": 0.008927690796554089,
      "rmse_dy": 0.007959720678627491,
      "rmse_mean": 0.014454405754804611,
      "rotation_flip": 0.007382550276815891,
      "sparse_tokens": 32137.0,
      "step": 1684,
      "turn_loss": 0.1299549639225006,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07828470544508456,
      "grad_norm": 0.6559848189353943,
      "learning_rate": 9.578419252902413e-06,
      "loss": 0.1849,
      "mae_dtheta": 0.010472923517227173,
      "mae_dx": 0.002552610356360674,
      "mae_dy": 0.0022404780611395836,
      "pose_mae_dtheta": 0.07514678686857224,
      "pose_mae_dx": 0.028055131435394287,
      "pose_mae_dy": 0.02886095456779003,
      "pose_rmse_dtheta": 0.16468928754329681,
      "pose_rmse_dx": 0.06903896480798721,
      "pose_rmse_dy": 0.061752624809741974,
      "pose_rmse_mean": 0.09849362820386887,
      "rmse_dtheta": 0.020767750218510628,
      "rmse_dx": 0.0076063815504312515,
      "rmse_dy": 0.004141179379075766,
      "rmse_mean": 0.010838436894118786,
      "rotation_flip": 0.008114374242722988,
      "sparse_tokens": 32089.0,
      "step": 1685,
      "turn_loss": 0.09271500259637833,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07833116521092734,
      "grad_norm": 0.5548566579818726,
      "learning_rate": 9.577887693816794e-06,
      "loss": 0.1342,
      "mae_dtheta": 0.017650056630373,
      "mae_dx": 0.004128007683902979,
      "mae_dy": 0.005479500163346529,
      "pose_mae_dtheta": 0.12892737984657288,
      "pose_mae_dx": 0.053977321833372116,
      "pose_mae_dy": 0.05855095013976097,
      "pose_rmse_dtheta": 0.290198415517807,
      "pose_rmse_dx": 0.1514807939529419,
      "pose_rmse_dy": 0.1431257128715515,
      "pose_rmse_mean": 0.19493496417999268,
      "rmse_dtheta": 0.033185333013534546,
      "rmse_dx": 0.012285363860428333,
      "rmse_dy": 0.014651063829660416,
      "rmse_mean": 0.020040586590766907,
      "rotation_flip": 0.0065721203573048115,
      "sparse_tokens": 32089.0,
      "step": 1686,
      "turn_loss": 0.16852666437625885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27173.0,
      "epoch": 0.07837762497677012,
      "grad_norm": 0.4993824362754822,
      "learning_rate": 9.577355814597031e-06,
      "loss": 0.1835,
      "mae_dtheta": 0.041386786848306656,
      "mae_dx": 0.009315339848399162,
      "mae_dy": 0.004837622866034508,
      "pose_mae_dtheta": 0.34479615092277527,
      "pose_mae_dx": 0.0759594738483429,
      "pose_mae_dy": 0.04944988340139389,
      "pose_rmse_dtheta": 0.5778613090515137,
      "pose_rmse_dx": 0.1795712113380432,
      "pose_rmse_dy": 0.13000133633613586,
      "pose_rmse_mean": 0.2958112955093384,
      "rmse_dtheta": 0.06056822091341019,
      "rmse_dx": 0.020293259993195534,
      "rmse_dy": 0.012014406733214855,
      "rmse_mean": 0.03095862828195095,
      "rotation_flip": 0.011283498257398605,
      "sparse_tokens": 21640.0,
      "step": 1687,
      "turn_loss": 0.28357183933258057,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.07842408474261289,
      "grad_norm": 0.4705813527107239,
      "learning_rate": 9.576823615280319e-06,
      "loss": 0.1095,
      "mae_dtheta": 0.027623962610960007,
      "mae_dx": 0.009125483222305775,
      "mae_dy": 0.004529171157628298,
      "pose_mae_dtheta": 0.21900810301303864,
      "pose_mae_dx": 0.07682851701974869,
      "pose_mae_dy": 0.06511946767568588,
      "pose_rmse_dtheta": 0.44660481810569763,
      "pose_rmse_dx": 0.2075279802083969,
      "pose_rmse_dy": 0.14788362383842468,
      "pose_rmse_mean": 0.2673388123512268,
      "rmse_dtheta": 0.04718223586678505,
      "rmse_dx": 0.022928979247808456,
      "rmse_dy": 0.009304302744567394,
      "rmse_mean": 0.026471838355064392,
      "rotation_flip": 0.003246753243729472,
      "sparse_tokens": 5807.0,
      "step": 1688,
      "turn_loss": 0.16259625554084778,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.07847054450845568,
      "grad_norm": 0.5492889285087585,
      "learning_rate": 9.576291095903874e-06,
      "loss": 0.1817,
      "mae_dtheta": 0.030691154301166534,
      "mae_dx": 0.011461053043603897,
      "mae_dy": 0.004020359367132187,
      "pose_mae_dtheta": 0.2215089499950409,
      "pose_mae_dx": 0.09533188492059708,
      "pose_mae_dy": 0.04511823505163193,
      "pose_rmse_dtheta": 0.4042673408985138,
      "pose_rmse_dx": 0.20442327857017517,
      "pose_rmse_dy": 0.10098927468061447,
      "pose_rmse_mean": 0.23655997216701508,
      "rmse_dtheta": 0.04804150387644768,
      "rmse_dx": 0.02282983809709549,
      "rmse_dy": 0.007823318243026733,
      "rmse_mean": 0.0262315534055233,
      "rotation_flip": 0.006002401001751423,
      "sparse_tokens": 14210.0,
      "step": 1689,
      "turn_loss": 0.24827264249324799,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.07851700427429846,
      "grad_norm": 0.522887647151947,
      "learning_rate": 9.575758256504938e-06,
      "loss": 0.0814,
      "mae_dtheta": 0.009815836325287819,
      "mae_dx": 0.0023318901658058167,
      "mae_dy": 0.0008029815508052707,
      "pose_mae_dtheta": 0.07230866700410843,
      "pose_mae_dx": 0.020652856677770615,
      "pose_mae_dy": 0.01494774129241705,
      "pose_rmse_dtheta": 0.22094415128231049,
      "pose_rmse_dx": 0.05928873270750046,
      "pose_rmse_dy": 0.046806614845991135,
      "pose_rmse_mean": 0.1090131625533104,
      "rmse_dtheta": 0.028140690177679062,
      "rmse_dx": 0.00744658662006259,
      "rmse_dy": 0.0022314514499157667,
      "rmse_mean": 0.0126062436029315,
      "rotation_flip": 0.0020140986889600754,
      "sparse_tokens": 32217.0,
      "step": 1690,
      "turn_loss": 0.060614172369241714,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.07856346404014124,
      "grad_norm": 0.712235689163208,
      "learning_rate": 9.57522509712077e-06,
      "loss": 0.1877,
      "mae_dtheta": 0.0262305848300457,
      "mae_dx": 0.015686925500631332,
      "mae_dy": 0.0075632669031620026,
      "pose_mae_dtheta": 0.18018415570259094,
      "pose_mae_dx": 0.14353065192699432,
      "pose_mae_dy": 0.07693789154291153,
      "pose_rmse_dtheta": 0.2837083041667938,
      "pose_rmse_dx": 0.2983803153038025,
      "pose_rmse_dy": 0.11981598287820816,
      "pose_rmse_mean": 0.23396819829940796,
      "rmse_dtheta": 0.03738117590546608,
      "rmse_dx": 0.02916300855576992,
      "rmse_dy": 0.011852843686938286,
      "rmse_mean": 0.02613234333693981,
      "rotation_flip": 0.007462686393409967,
      "sparse_tokens": 6895.0,
      "step": 1691,
      "turn_loss": 0.40030768513679504,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07860992380598401,
      "grad_norm": 0.6490556597709656,
      "learning_rate": 9.574691617788656e-06,
      "loss": 0.1445,
      "mae_dtheta": 0.009767400100827217,
      "mae_dx": 0.0015734019689261913,
      "mae_dy": 0.0018350583268329501,
      "pose_mae_dtheta": 0.06877584755420685,
      "pose_mae_dx": 0.02063746750354767,
      "pose_mae_dy": 0.02903328835964203,
      "pose_rmse_dtheta": 0.1374107003211975,
      "pose_rmse_dx": 0.05121607333421707,
      "pose_rmse_dy": 0.06596887856721878,
      "pose_rmse_mean": 0.08486521244049072,
      "rmse_dtheta": 0.019734278321266174,
      "rmse_dx": 0.005127602722495794,
      "rmse_dy": 0.003710460616275668,
      "rmse_mean": 0.009524114429950714,
      "rotation_flip": 0.0013440860202535987,
      "sparse_tokens": 32089.0,
      "step": 1692,
      "turn_loss": 0.07537670433521271,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17859.0,
      "epoch": 0.0786563835718268,
      "grad_norm": 0.44148004055023193,
      "learning_rate": 9.574157818545902e-06,
      "loss": 0.126,
      "mae_dtheta": 0.03152431175112724,
      "mae_dx": 0.013725302182137966,
      "mae_dy": 0.0071958741173148155,
      "pose_mae_dtheta": 0.248421773314476,
      "pose_mae_dx": 0.12215563654899597,
      "pose_mae_dy": 0.08651826530694962,
      "pose_rmse_dtheta": 0.39700475335121155,
      "pose_rmse_dx": 0.26215505599975586,
      "pose_rmse_dy": 0.22538524866104126,
      "pose_rmse_mean": 0.29484835267066956,
      "rmse_dtheta": 0.04555973783135414,
      "rmse_dx": 0.026711149141192436,
      "rmse_dy": 0.014491049572825432,
      "rmse_mean": 0.028920646756887436,
      "rotation_flip": 0.014379085041582584,
      "sparse_tokens": 14523.0,
      "step": 1693,
      "turn_loss": 0.28460443019866943,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.07870284333766958,
      "grad_norm": 0.6275424361228943,
      "learning_rate": 9.573623699429837e-06,
      "loss": 0.0801,
      "mae_dtheta": 0.008678864687681198,
      "mae_dx": 0.002110767411068082,
      "mae_dy": 0.0005657928995788097,
      "pose_mae_dtheta": 0.06482435762882233,
      "pose_mae_dx": 0.01939663290977478,
      "pose_mae_dy": 0.008480324409902096,
      "pose_rmse_dtheta": 0.2548387944698334,
      "pose_rmse_dx": 0.04669690504670143,
      "pose_rmse_dy": 0.025140466168522835,
      "pose_rmse_mean": 0.1088920533657074,
      "rmse_dtheta": 0.02928289771080017,
      "rmse_dx": 0.005540023557841778,
      "rmse_dy": 0.0012341456022113562,
      "rmse_mean": 0.01201902236789465,
      "rotation_flip": 0.0011911852052435279,
      "sparse_tokens": 32201.0,
      "step": 1694,
      "turn_loss": 0.061837464570999146,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.07874930310351236,
      "grad_norm": 0.5306719541549683,
      "learning_rate": 9.57308926047781e-06,
      "loss": 0.1068,
      "mae_dtheta": 0.015326859429478645,
      "mae_dx": 0.0039453753270208836,
      "mae_dy": 0.0051576499827206135,
      "pose_mae_dtheta": 0.11602137237787247,
      "pose_mae_dx": 0.0487990602850914,
      "pose_mae_dy": 0.05389195680618286,
      "pose_rmse_dtheta": 0.27215132117271423,
      "pose_rmse_dx": 0.1382354348897934,
      "pose_rmse_dy": 0.16091619431972504,
      "pose_rmse_mean": 0.1904343217611313,
      "rmse_dtheta": 0.030941834673285484,
      "rmse_dx": 0.01094208937138319,
      "rmse_dy": 0.0120557164773345,
      "rmse_mean": 0.017979880794882774,
      "rotation_flip": 0.012387387454509735,
      "sparse_tokens": 32121.0,
      "step": 1695,
      "turn_loss": 0.1461874097585678,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.07879576286935513,
      "grad_norm": 0.6016148924827576,
      "learning_rate": 9.572554501727198e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.03976224362850189,
      "mae_dx": 0.016351744532585144,
      "mae_dy": 0.009281202219426632,
      "pose_mae_dtheta": 0.3035491406917572,
      "pose_mae_dx": 0.13014186918735504,
      "pose_mae_dy": 0.11309639364480972,
      "pose_rmse_dtheta": 0.46642857789993286,
      "pose_rmse_dx": 0.25433245301246643,
      "pose_rmse_dy": 0.20486237108707428,
      "pose_rmse_mean": 0.3085411489009857,
      "rmse_dtheta": 0.05439617857336998,
      "rmse_dx": 0.029151996597647667,
      "rmse_dy": 0.01621539518237114,
      "rmse_mean": 0.03325452655553818,
      "rotation_flip": 0.011472275480628014,
      "sparse_tokens": 8430.0,
      "step": 1696,
      "turn_loss": 0.39833542704582214,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.07884222263519793,
      "grad_norm": 0.4604962468147278,
      "learning_rate": 9.572019423215395e-06,
      "loss": 0.1151,
      "mae_dtheta": 0.031104180961847305,
      "mae_dx": 0.010646646842360497,
      "mae_dy": 0.0084847966209054,
      "pose_mae_dtheta": 0.2040598839521408,
      "pose_mae_dx": 0.10053592175245285,
      "pose_mae_dy": 0.0870884358882904,
      "pose_rmse_dtheta": 0.34791162610054016,
      "pose_rmse_dx": 0.20369203388690948,
      "pose_rmse_dy": 0.17246757447719574,
      "pose_rmse_mean": 0.24135708808898926,
      "rmse_dtheta": 0.0478593073785305,
      "rmse_dx": 0.020932575687766075,
      "rmse_dy": 0.016093289479613304,
      "rmse_mean": 0.028295058757066727,
      "rotation_flip": 0.016304347664117813,
      "sparse_tokens": 10635.0,
      "step": 1697,
      "turn_loss": 0.35297691822052,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.0788886824010407,
      "grad_norm": 0.5090237259864807,
      "learning_rate": 9.571484024979821e-06,
      "loss": 0.129,
      "mae_dtheta": 0.015347428619861603,
      "mae_dx": 0.003181973472237587,
      "mae_dy": 0.004812297876924276,
      "pose_mae_dtheta": 0.10512197762727737,
      "pose_mae_dx": 0.044428735971450806,
      "pose_mae_dy": 0.04905552789568901,
      "pose_rmse_dtheta": 0.22228212654590607,
      "pose_rmse_dx": 0.10518915951251984,
      "pose_rmse_dy": 0.11442022770643234,
      "pose_rmse_mean": 0.14729717373847961,
      "rmse_dtheta": 0.028909867629408836,
      "rmse_dx": 0.007825858891010284,
      "rmse_dy": 0.010662299580872059,
      "rmse_mean": 0.015799343585968018,
      "rotation_flip": 0.013771186582744122,
      "sparse_tokens": 32137.0,
      "step": 1698,
      "turn_loss": 0.14844459295272827,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.07893514216688348,
      "grad_norm": 0.4351086914539337,
      "learning_rate": 9.570948307057912e-06,
      "loss": 0.1042,
      "mae_dtheta": 0.01136695221066475,
      "mae_dx": 0.002584148896858096,
      "mae_dy": 0.002103218110278249,
      "pose_mae_dtheta": 0.07490948587656021,
      "pose_mae_dx": 0.02645844966173172,
      "pose_mae_dy": 0.02443428337574005,
      "pose_rmse_dtheta": 0.18480965495109558,
      "pose_rmse_dx": 0.06386086344718933,
      "pose_rmse_dy": 0.05578844994306564,
      "pose_rmse_mean": 0.10148632526397705,
      "rmse_dtheta": 0.025033675134181976,
      "rmse_dx": 0.007375700864940882,
      "rmse_dy": 0.005160003434866667,
      "rmse_mean": 0.012523127719759941,
      "rotation_flip": 0.005503810476511717,
      "sparse_tokens": 32153.0,
      "step": 1699,
      "turn_loss": 0.09981097280979156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.07898160193272626,
      "grad_norm": 0.5073747038841248,
      "learning_rate": 9.570412269487137e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.012062884867191315,
      "mae_dx": 0.003918719943612814,
      "mae_dy": 0.003920076880604029,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5073748230934143,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 143.6075439453125,
      "model/head/act_norm_mean": 105.57378472222223,
      "model/head/act_norm_min": 71.64318084716797,
      "model/head/act_over_embed": 72.55129325845614,
      "model/head/grad_frac": 0.10977408289909363,
      "model/head/grad_norm": 0.05569660663604736,
      "model/head/grad_zero_frac": 0.00016022224735934287,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6866615372474747,
      "model/head/update_ratio": 0.0009676236077211797,
      "model/head/weight_delta": 4.670331001281738,
      "model/head/weight_delta_rel": 0.08193144202232361,
      "model/head/weight_norm": 57.56019973754883,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41366901993751526,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4136062074669808,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4135330319404602,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28423405801363166,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05387229844927788,
      "model/modality_embedder.encoders.pose/grad_norm": 0.027333447709679604,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5238666619955157,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0008892391342669725,
      "model/modality_embedder.encoders.pose/weight_delta": 1.5107641220092773,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.049361374229192734,
      "model/modality_embedder.encoders.pose/weight_norm": 30.738018035888672,
      "model/modality_embedder/grad_frac": 0.05387229844927788,
      "model/modality_embedder/grad_norm": 0.027333447709679604,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5238666619955157,
      "model/modality_embedder/update_ratio": 0.0008892391342669725,
      "model/modality_embedder/weight_delta": 1.5107641220092773,
      "model/modality_embedder/weight_delta_rel": 0.049361374229192734,
      "model/modality_embedder/weight_norm": 30.738018035888672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.27215576171875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.98136874699375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.929327011108398,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.793011757898135,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09528345614671707,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04834442585706711,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001753033371642232,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.8804476857185364,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03208404406905174,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.577585220336914,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.1309814453125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.063456990540324,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.387921333312988,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.536632929533088,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09388809651136398,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04763645678758621,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016359862638637424,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.0921196937561035,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.037831880152225494,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.117883682250977,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 77.60227966308594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.040511764470097,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.999614715576172,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.895283479656044,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.12054964154958725,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.061163853853940964,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002035485114902258,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.1576294898986816,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.03887103125452995,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.048786163330078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 78.60396575927734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.95369368286035,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.408888816833496,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.210040005465146,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1625717133283615,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08248479664325714,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 7.06100690877065e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002800311893224716,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 0.9874120354652405,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03374505788087845,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.45557403564453,
      "model/normalizer/grad_frac": 0.6575871109962463,
      "model/normalizer/grad_norm": 0.3336431384086609,
      "model/normalizer/grad_zero_frac": 0.00011108341277576983,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0042816633358597755,
      "model/normalizer/weight_delta": 2.1196885108947754,
      "model/normalizer/weight_delta_rel": 0.027300361543893814,
      "model/normalizer/weight_norm": 77.92372131347656,
      "pose_mae_dtheta": 0.08738529682159424,
      "pose_mae_dx": 0.04339507594704628,
      "pose_mae_dy": 0.04976128041744232,
      "pose_rmse_dtheta": 0.1421864628791809,
      "pose_rmse_dx": 0.11566474288702011,
      "pose_rmse_dy": 0.101577989757061,
      "pose_rmse_mean": 0.11980973929166794,
      "rmse_dtheta": 0.019559446722269058,
      "rmse_dx": 0.012170582078397274,
      "rmse_dy": 0.006736920680850744,
      "rmse_mean": 0.012822316959500313,
      "rotation_flip": 0.006329114083200693,
      "sparse_tokens": 32105.0,
      "step": 1700,
      "turn_loss": 0.1405661553144455,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.07902806169856903,
      "grad_norm": 0.6167083978652954,
      "learning_rate": 9.56987591230498e-06,
      "loss": 0.1644,
      "mae_dtheta": 0.017194004729390144,
      "mae_dx": 0.004163932520896196,
      "mae_dy": 0.004384870175272226,
      "pose_mae_dtheta": 0.11994466185569763,
      "pose_mae_dx": 0.04839982092380524,
      "pose_mae_dy": 0.049418557435274124,
      "pose_rmse_dtheta": 0.2768344283103943,
      "pose_rmse_dx": 0.14108122885227203,
      "pose_rmse_dy": 0.14301928877830505,
      "pose_rmse_mean": 0.1869783103466034,
      "rmse_dtheta": 0.03413531556725502,
      "rmse_dx": 0.01193059142678976,
      "rmse_dy": 0.010580512695014477,
      "rmse_mean": 0.018882140517234802,
      "rotation_flip": 0.008348457515239716,
      "sparse_tokens": 32137.0,
      "step": 1701,
      "turn_loss": 0.1759059578180313,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.07907452146441182,
      "grad_norm": 0.688963770866394,
      "learning_rate": 9.569339235548946e-06,
      "loss": 0.156,
      "mae_dtheta": 0.008107890374958515,
      "mae_dx": 0.0018132166005671024,
      "mae_dy": 0.0002933780779130757,
      "pose_mae_dtheta": 0.05757926031947136,
      "pose_mae_dx": 0.0160515196621418,
      "pose_mae_dy": 0.004327687900513411,
      "pose_rmse_dtheta": 0.22074764966964722,
      "pose_rmse_dx": 0.0381232425570488,
      "pose_rmse_dy": 0.008744355291128159,
      "pose_rmse_mean": 0.08920508623123169,
      "rmse_dtheta": 0.02843792922794819,
      "rmse_dx": 0.004966456908732653,
      "rmse_dy": 0.0005302888457663357,
      "rmse_mean": 0.01131155900657177,
      "rotation_flip": 0.001617250731214881,
      "sparse_tokens": 32249.0,
      "step": 1702,
      "turn_loss": 0.05522157624363899,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15543.0,
      "epoch": 0.0791209812302546,
      "grad_norm": 0.6980188488960266,
      "learning_rate": 9.568802239256568e-06,
      "loss": 0.1543,
      "mae_dtheta": 0.04863126575946808,
      "mae_dx": 0.014181538484990597,
      "mae_dy": 0.006550709251314402,
      "pose_mae_dtheta": 0.4086536169052124,
      "pose_mae_dx": 0.11829306930303574,
      "pose_mae_dy": 0.07368434220552444,
      "pose_rmse_dtheta": 0.6458324193954468,
      "pose_rmse_dx": 0.2269573211669922,
      "pose_rmse_dy": 0.1552608758211136,
      "pose_rmse_mean": 0.3426835536956787,
      "rmse_dtheta": 0.06706424057483673,
      "rmse_dx": 0.025896770879626274,
      "rmse_dy": 0.012070117518305779,
      "rmse_mean": 0.03501037880778313,
      "rotation_flip": 0.006784260738641024,
      "sparse_tokens": 12737.0,
      "step": 1703,
      "turn_loss": 0.3778505027294159,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.07916744099609738,
      "grad_norm": 0.5952979326248169,
      "learning_rate": 9.568264923465395e-06,
      "loss": 0.1737,
      "mae_dtheta": 0.027210811153054237,
      "mae_dx": 0.008324773982167244,
      "mae_dy": 0.006073635071516037,
      "pose_mae_dtheta": 0.20007196068763733,
      "pose_mae_dx": 0.0661938488483429,
      "pose_mae_dy": 0.06062890216708183,
      "pose_rmse_dtheta": 0.3908929228782654,
      "pose_rmse_dx": 0.17256340384483337,
      "pose_rmse_dy": 0.12855264544487,
      "pose_rmse_mean": 0.23066966235637665,
      "rmse_dtheta": 0.04494275897741318,
      "rmse_dx": 0.019020499661564827,
      "rmse_dy": 0.013242424465715885,
      "rmse_mean": 0.02573522739112377,
      "rotation_flip": 0.014301430433988571,
      "sparse_tokens": 18840.0,
      "step": 1704,
      "turn_loss": 0.24467407166957855,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 35254.0,
      "epoch": 0.07921390076194015,
      "grad_norm": 0.5749667286872864,
      "learning_rate": 9.567727288213005e-06,
      "loss": 0.1594,
      "mae_dtheta": 0.03674256429076195,
      "mae_dx": 0.011003059335052967,
      "mae_dy": 0.005109984427690506,
      "pose_mae_dtheta": 0.3001437485218048,
      "pose_mae_dx": 0.0963074117898941,
      "pose_mae_dy": 0.07415907084941864,
      "pose_rmse_dtheta": 0.49483761191368103,
      "pose_rmse_dx": 0.21486593782901764,
      "pose_rmse_dy": 0.16309493780136108,
      "pose_rmse_mean": 0.290932834148407,
      "rmse_dtheta": 0.052670832723379135,
      "rmse_dx": 0.023190651088953018,
      "rmse_dy": 0.008973315358161926,
      "rmse_mean": 0.02827826701104641,
      "rotation_flip": 0.013673088513314724,
      "sparse_tokens": 28149.0,
      "step": 1705,
      "turn_loss": 0.25624945759773254,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.07926036052778294,
      "grad_norm": 0.4293237030506134,
      "learning_rate": 9.567189333536994e-06,
      "loss": 0.0773,
      "mae_dtheta": 0.0150179797783494,
      "mae_dx": 0.0025262858252972364,
      "mae_dy": 0.002736962866038084,
      "pose_mae_dtheta": 0.10537269711494446,
      "pose_mae_dx": 0.03283048793673515,
      "pose_mae_dy": 0.03768934682011604,
      "pose_rmse_dtheta": 0.24774351716041565,
      "pose_rmse_dx": 0.07498159259557724,
      "pose_rmse_dy": 0.08942003548145294,
      "pose_rmse_mean": 0.13738171756267548,
      "rmse_dtheta": 0.030308546498417854,
      "rmse_dx": 0.006687691900879145,
      "rmse_dy": 0.006181064527481794,
      "rmse_mean": 0.014392434619367123,
      "rotation_flip": 0.006676557939499617,
      "sparse_tokens": 32153.0,
      "step": 1706,
      "turn_loss": 0.11860793828964233,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.07930682029362572,
      "grad_norm": 0.8705823421478271,
      "learning_rate": 9.566651059474983e-06,
      "loss": 0.1359,
      "mae_dtheta": 0.03141966089606285,
      "mae_dx": 0.0145032973960042,
      "mae_dy": 0.004156474024057388,
      "pose_mae_dtheta": 0.25837549567222595,
      "pose_mae_dx": 0.11362051963806152,
      "pose_mae_dy": 0.08116640150547028,
      "pose_rmse_dtheta": 0.4319181740283966,
      "pose_rmse_dx": 0.2752326726913452,
      "pose_rmse_dy": 0.15758883953094482,
      "pose_rmse_mean": 0.2882465720176697,
      "rmse_dtheta": 0.0448952354490757,
      "rmse_dx": 0.029148641973733902,
      "rmse_dy": 0.006998816970735788,
      "rmse_mean": 0.0270142313092947,
      "rotation_flip": 0.002597402548417449,
      "sparse_tokens": 6413.0,
      "step": 1707,
      "turn_loss": 0.21591734886169434,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 14253.0,
      "epoch": 0.0793532800594685,
      "grad_norm": 0.9014900326728821,
      "learning_rate": 9.56611246606461e-06,
      "loss": 0.2824,
      "mae_dtheta": 0.037028487771749496,
      "mae_dx": 0.01130546536296606,
      "mae_dy": 0.004814353305846453,
      "pose_mae_dtheta": 0.30234864354133606,
      "pose_mae_dx": 0.10207013040781021,
      "pose_mae_dy": 0.05756945535540581,
      "pose_rmse_dtheta": 0.5241348147392273,
      "pose_rmse_dx": 0.20327812433242798,
      "pose_rmse_dy": 0.14533858001232147,
      "pose_rmse_mean": 0.29091718792915344,
      "rmse_dtheta": 0.05574236810207367,
      "rmse_dx": 0.021974802017211914,
      "rmse_dy": 0.010660513304173946,
      "rmse_mean": 0.029459228739142418,
      "rotation_flip": 0.006858710665255785,
      "sparse_tokens": 11241.0,
      "step": 1708,
      "turn_loss": 0.2662073075771332,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.07939973982531127,
      "grad_norm": 0.5722498893737793,
      "learning_rate": 9.565573553343543e-06,
      "loss": 0.1516,
      "mae_dtheta": 0.04188071936368942,
      "mae_dx": 0.014864888973534107,
      "mae_dy": 0.004917812068015337,
      "pose_mae_dtheta": 0.3292779326438904,
      "pose_mae_dx": 0.12517188489437103,
      "pose_mae_dy": 0.05282321199774742,
      "pose_rmse_dtheta": 0.5675967335700989,
      "pose_rmse_dx": 0.23888340592384338,
      "pose_rmse_dy": 0.13440997898578644,
      "pose_rmse_mean": 0.31363004446029663,
      "rmse_dtheta": 0.059838246554136276,
      "rmse_dx": 0.026457838714122772,
      "rmse_dy": 0.010161164216697216,
      "rmse_mean": 0.032152414321899414,
      "rotation_flip": 0.006818181835114956,
      "sparse_tokens": 19070.0,
      "step": 1709,
      "turn_loss": 0.3541974425315857,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07944619959115407,
      "grad_norm": 0.7566210031509399,
      "learning_rate": 9.565034321349467e-06,
      "loss": 0.2519,
      "mae_dtheta": 0.016694581136107445,
      "mae_dx": 0.005438180174678564,
      "mae_dy": 0.006064143031835556,
      "pose_mae_dtheta": 0.12539055943489075,
      "pose_mae_dx": 0.06944291293621063,
      "pose_mae_dy": 0.058039333671331406,
      "pose_rmse_dtheta": 0.27313023805618286,
      "pose_rmse_dx": 0.2049383819103241,
      "pose_rmse_dy": 0.14453125,
      "pose_rmse_mean": 0.20753328502178192,
      "rmse_dtheta": 0.03182040899991989,
      "rmse_dx": 0.01558958925306797,
      "rmse_dy": 0.013484771363437176,
      "rmse_mean": 0.02029825747013092,
      "rotation_flip": 0.010591672733426094,
      "sparse_tokens": 32073.0,
      "step": 1710,
      "turn_loss": 0.17569224536418915,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.07949265935699684,
      "grad_norm": 0.406074196100235,
      "learning_rate": 9.564494770120089e-06,
      "loss": 0.0721,
      "mae_dtheta": 0.007580429781228304,
      "mae_dx": 0.0016606661956757307,
      "mae_dy": 0.0007754304679110646,
      "pose_mae_dtheta": 0.05303929001092911,
      "pose_mae_dx": 0.014995657838881016,
      "pose_mae_dy": 0.01328502967953682,
      "pose_rmse_dtheta": 0.15680168569087982,
      "pose_rmse_dx": 0.03454113006591797,
      "pose_rmse_dy": 0.03680695593357086,
      "pose_rmse_mean": 0.07604992389678955,
      "rmse_dtheta": 0.022748131304979324,
      "rmse_dx": 0.004764849320054054,
      "rmse_dy": 0.0017758290050551295,
      "rmse_mean": 0.00976293720304966,
      "rotation_flip": 0.0021175225265324116,
      "sparse_tokens": 32201.0,
      "step": 1711,
      "turn_loss": 0.04812300205230713,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.07953911912283962,
      "grad_norm": 0.7579713463783264,
      "learning_rate": 9.563954899693144e-06,
      "loss": 0.154,
      "mae_dtheta": 0.014794591814279556,
      "mae_dx": 0.0029631403740495443,
      "mae_dy": 0.0036045473534613848,
      "pose_mae_dtheta": 0.10315065830945969,
      "pose_mae_dx": 0.03352779522538185,
      "pose_mae_dy": 0.04228812828660011,
      "pose_rmse_dtheta": 0.2270418107509613,
      "pose_rmse_dx": 0.09054287523031235,
      "pose_rmse_dy": 0.11420240998268127,
      "pose_rmse_mean": 0.14392903447151184,
      "rmse_dtheta": 0.02897254005074501,
      "rmse_dx": 0.00870045367628336,
      "rmse_dy": 0.008257035166025162,
      "rmse_mean": 0.015310009941458702,
      "rotation_flip": 0.006028939038515091,
      "sparse_tokens": 32089.0,
      "step": 1712,
      "turn_loss": 0.12337630987167358,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.0795855788886824,
      "grad_norm": 0.797333836555481,
      "learning_rate": 9.563414710106382e-06,
      "loss": 0.1441,
      "mae_dtheta": 0.015565264038741589,
      "mae_dx": 0.0025006546638906,
      "mae_dy": 0.003731554839760065,
      "pose_mae_dtheta": 0.11015861481428146,
      "pose_mae_dx": 0.03427046164870262,
      "pose_mae_dy": 0.04353945702314377,
      "pose_rmse_dtheta": 0.2715895473957062,
      "pose_rmse_dx": 0.08888804167509079,
      "pose_rmse_dy": 0.0986909344792366,
      "pose_rmse_mean": 0.15305617451667786,
      "rmse_dtheta": 0.031253524124622345,
      "rmse_dx": 0.008035792969167233,
      "rmse_dy": 0.007677367888391018,
      "rmse_mean": 0.01565556228160858,
      "rotation_flip": 0.0062283738516271114,
      "sparse_tokens": 32073.0,
      "step": 1713,
      "turn_loss": 0.12502846121788025,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5873.0,
      "epoch": 0.07963203865452519,
      "grad_norm": 0.8226153254508972,
      "learning_rate": 9.56287420139758e-06,
      "loss": 0.1782,
      "mae_dtheta": 0.02228540927171707,
      "mae_dx": 0.012915016151964664,
      "mae_dy": 0.0020931162871420383,
      "pose_mae_dtheta": 0.18114595115184784,
      "pose_mae_dx": 0.09382952004671097,
      "pose_mae_dy": 0.020397892221808434,
      "pose_rmse_dtheta": 0.3083834946155548,
      "pose_rmse_dx": 0.2229035198688507,
      "pose_rmse_dy": 0.04772515594959259,
      "pose_rmse_mean": 0.1930040568113327,
      "rmse_dtheta": 0.03560711443424225,
      "rmse_dx": 0.025079036131501198,
      "rmse_dy": 0.0043611302971839905,
      "rmse_mean": 0.02168242633342743,
      "rotation_flip": 0.0,
      "sparse_tokens": 4949.0,
      "step": 1714,
      "turn_loss": 0.22229793667793274,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.07967849842036796,
      "grad_norm": 0.4732482433319092,
      "learning_rate": 9.562333373604537e-06,
      "loss": 0.1794,
      "mae_dtheta": 0.010819856077432632,
      "mae_dx": 0.002665749052539468,
      "mae_dy": 0.002629754366353154,
      "pose_mae_dtheta": 0.07572590559720993,
      "pose_mae_dx": 0.026106134057044983,
      "pose_mae_dy": 0.02812516875565052,
      "pose_rmse_dtheta": 0.1960899382829666,
      "pose_rmse_dx": 0.07525105774402618,
      "pose_rmse_dy": 0.07363617420196533,
      "pose_rmse_mean": 0.11499239504337311,
      "rmse_dtheta": 0.02436533384025097,
      "rmse_dx": 0.007878202944993973,
      "rmse_dy": 0.006835083477199078,
      "rmse_mean": 0.013026206754148006,
      "rotation_flip": 0.005506141576915979,
      "sparse_tokens": 32153.0,
      "step": 1715,
      "turn_loss": 0.10201036185026169,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31046.0,
      "epoch": 0.07972495818621074,
      "grad_norm": 0.5088025331497192,
      "learning_rate": 9.561792226765072e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.03451690450310707,
      "mae_dx": 0.01526234857738018,
      "mae_dy": 0.006511521525681019,
      "pose_mae_dtheta": 0.27581244707107544,
      "pose_mae_dx": 0.11774081736803055,
      "pose_mae_dy": 0.08012167364358902,
      "pose_rmse_dtheta": 0.4635844826698303,
      "pose_rmse_dx": 0.2509283423423767,
      "pose_rmse_dy": 0.17120859026908875,
      "pose_rmse_mean": 0.29524049162864685,
      "rmse_dtheta": 0.0507381297647953,
      "rmse_dx": 0.02802129089832306,
      "rmse_dy": 0.011898711323738098,
      "rmse_mean": 0.03021937608718872,
      "rotation_flip": 0.016212232410907745,
      "sparse_tokens": 25122.0,
      "step": 1716,
      "turn_loss": 0.3260585069656372,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.07977141795205352,
      "grad_norm": 0.4688059687614441,
      "learning_rate": 9.561250760917026e-06,
      "loss": 0.1139,
      "mae_dtheta": 0.012515485286712646,
      "mae_dx": 0.001932096085511148,
      "mae_dy": 0.0027695209719240665,
      "pose_mae_dtheta": 0.08523160964250565,
      "pose_mae_dx": 0.02711726725101471,
      "pose_mae_dy": 0.03520011156797409,
      "pose_rmse_dtheta": 0.16812874376773834,
      "pose_rmse_dx": 0.06325981765985489,
      "pose_rmse_dy": 0.06880805641412735,
      "pose_rmse_mean": 0.10006554424762726,
      "rmse_dtheta": 0.023975348100066185,
      "rmse_dx": 0.006199153605848551,
      "rmse_dy": 0.0051786708645522594,
      "rmse_mean": 0.011784391477704048,
      "rotation_flip": 0.003869968932121992,
      "sparse_tokens": 32057.0,
      "step": 1717,
      "turn_loss": 0.08792081475257874,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6845.0,
      "epoch": 0.07981787771789631,
      "grad_norm": 0.8303542733192444,
      "learning_rate": 9.56070897609827e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.02796768955886364,
      "mae_dx": 0.00740140350535512,
      "mae_dy": 0.005966516677290201,
      "pose_mae_dtheta": 0.20133377611637115,
      "pose_mae_dx": 0.031470153480768204,
      "pose_mae_dy": 0.07412296533584595,
      "pose_rmse_dtheta": 0.3994634747505188,
      "pose_rmse_dx": 0.08349283784627914,
      "pose_rmse_dy": 0.2064179629087448,
      "pose_rmse_mean": 0.22979143261909485,
      "rmse_dtheta": 0.0472426638007164,
      "rmse_dx": 0.019293824210762978,
      "rmse_dy": 0.013063902966678143,
      "rmse_mean": 0.02653346210718155,
      "rotation_flip": 0.0063091483898460865,
      "sparse_tokens": 5408.0,
      "step": 1718,
      "turn_loss": 0.24664151668548584,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.07986433748373908,
      "grad_norm": 1.2171269655227661,
      "learning_rate": 9.560166872346685e-06,
      "loss": 0.1383,
      "mae_dtheta": 0.009611506946384907,
      "mae_dx": 0.0017112682107836008,
      "mae_dy": 0.0025040011387318373,
      "pose_mae_dtheta": 0.06967528909444809,
      "pose_mae_dx": 0.026014400646090508,
      "pose_mae_dy": 0.032652657479047775,
      "pose_rmse_dtheta": 0.14615745842456818,
      "pose_rmse_dx": 0.062196046113967896,
      "pose_rmse_dy": 0.08137631416320801,
      "pose_rmse_mean": 0.09657661616802216,
      "rmse_dtheta": 0.02015935629606247,
      "rmse_dx": 0.005137762986123562,
      "rmse_dy": 0.005491257645189762,
      "rmse_mean": 0.010262792930006981,
      "rotation_flip": 0.00737847201526165,
      "sparse_tokens": 32073.0,
      "step": 1719,
      "turn_loss": 0.07677215337753296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.07991079724958186,
      "grad_norm": 0.3955492079257965,
      "learning_rate": 9.559624449700183e-06,
      "loss": 0.1312,
      "mae_dtheta": 0.03922644257545471,
      "mae_dx": 0.01783314161002636,
      "mae_dy": 0.0067194318398833275,
      "pose_mae_dtheta": 0.31573325395584106,
      "pose_mae_dx": 0.1420542150735855,
      "pose_mae_dy": 0.0905722975730896,
      "pose_rmse_dtheta": 0.5357373952865601,
      "pose_rmse_dx": 0.27947232127189636,
      "pose_rmse_dy": 0.20188702642917633,
      "pose_rmse_mean": 0.33903226256370544,
      "rmse_dtheta": 0.0566844679415226,
      "rmse_dx": 0.031463611871004105,
      "rmse_dy": 0.011544535867869854,
      "rmse_mean": 0.033230870962142944,
      "rotation_flip": 0.011463845148682594,
      "sparse_tokens": 19561.0,
      "step": 1720,
      "turn_loss": 0.31490328907966614,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.07995725701542464,
      "grad_norm": 0.6096131205558777,
      "learning_rate": 9.559081708196696e-06,
      "loss": 0.1729,
      "mae_dtheta": 0.01175468135625124,
      "mae_dx": 0.0021060509607195854,
      "mae_dy": 0.0024418970569968224,
      "pose_mae_dtheta": 0.08714374154806137,
      "pose_mae_dx": 0.02818208932876587,
      "pose_mae_dy": 0.03630654886364937,
      "pose_rmse_dtheta": 0.18426662683486938,
      "pose_rmse_dx": 0.08054995536804199,
      "pose_rmse_dy": 0.08441956341266632,
      "pose_rmse_mean": 0.11641204357147217,
      "rmse_dtheta": 0.024088365957140923,
      "rmse_dx": 0.00716759217903018,
      "rmse_dy": 0.005108746234327555,
      "rmse_mean": 0.01212156843394041,
      "rotation_flip": 0.0030742203816771507,
      "sparse_tokens": 32057.0,
      "step": 1721,
      "turn_loss": 0.09521665424108505,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64148.0,
      "epoch": 0.08000371678126743,
      "grad_norm": 0.5748298168182373,
      "learning_rate": 9.558538647874179e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.011034592054784298,
      "mae_dx": 0.0023178372066468,
      "mae_dy": 0.0026623678859323263,
      "pose_mae_dtheta": 0.07950083911418915,
      "pose_mae_dx": 0.026430290192365646,
      "pose_mae_dy": 0.03156321495771408,
      "pose_rmse_dtheta": 0.19158019125461578,
      "pose_rmse_dx": 0.08304216712713242,
      "pose_rmse_dy": 0.08410041779279709,
      "pose_rmse_mean": 0.11957426369190216,
      "rmse_dtheta": 0.022982832044363022,
      "rmse_dx": 0.007849002256989479,
      "rmse_dy": 0.005816079676151276,
      "rmse_mean": 0.012215971946716309,
      "rotation_flip": 0.006522625219076872,
      "sparse_tokens": 32048.0,
      "step": 1722,
      "turn_loss": 0.08856561034917831,
      "turns": 197.0,
      "turns_per_sample": 197.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0800501765471102,
      "grad_norm": 0.417296439409256,
      "learning_rate": 9.557995268770609e-06,
      "loss": 0.0963,
      "mae_dtheta": 0.01262990664690733,
      "mae_dx": 0.0020624655298888683,
      "mae_dy": 0.0031840531155467033,
      "pose_mae_dtheta": 0.09340988099575043,
      "pose_mae_dx": 0.03450771048665047,
      "pose_mae_dy": 0.04389355704188347,
      "pose_rmse_dtheta": 0.19637499749660492,
      "pose_rmse_dx": 0.09702553600072861,
      "pose_rmse_dy": 0.11859989911317825,
      "pose_rmse_mean": 0.137333482503891,
      "rmse_dtheta": 0.02578297071158886,
      "rmse_dx": 0.006486208643764257,
      "rmse_dy": 0.007770583964884281,
      "rmse_mean": 0.013346588239073753,
      "rotation_flip": 0.006119951140135527,
      "sparse_tokens": 32089.0,
      "step": 1723,
      "turn_loss": 0.11779166013002396,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.08009663631295298,
      "grad_norm": 0.5467333793640137,
      "learning_rate": 9.55745157092398e-06,
      "loss": 0.0975,
      "mae_dtheta": 0.01034656073898077,
      "mae_dx": 0.0017033676849678159,
      "mae_dy": 0.0014080876717343926,
      "pose_mae_dtheta": 0.074260413646698,
      "pose_mae_dx": 0.022721275687217712,
      "pose_mae_dy": 0.021290570497512817,
      "pose_rmse_dtheta": 0.23448388278484344,
      "pose_rmse_dx": 0.0584489069879055,
      "pose_rmse_dy": 0.05484478920698166,
      "pose_rmse_mean": 0.1159258633852005,
      "rmse_dtheta": 0.028033612295985222,
      "rmse_dx": 0.005291192326694727,
      "rmse_dy": 0.003266359679400921,
      "rmse_mean": 0.012197054922580719,
      "rotation_flip": 0.003448275849223137,
      "sparse_tokens": 32105.0,
      "step": 1724,
      "turn_loss": 0.06550123542547226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30170.0,
      "epoch": 0.08014309607879576,
      "grad_norm": 0.6707329750061035,
      "learning_rate": 9.556907554372318e-06,
      "loss": 0.1498,
      "mae_dtheta": 0.030428040772676468,
      "mae_dx": 0.011846961453557014,
      "mae_dy": 0.0038168970495462418,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6707329154014587,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.0994110107422,
      "model/head/act_norm_mean": 97.0632560483871,
      "model/head/act_norm_min": 48.8204460144043,
      "model/head/act_over_embed": 66.70277827697187,
      "model/head/grad_frac": 0.09006546437740326,
      "model/head/grad_norm": 0.060409873723983765,
      "model/head/grad_zero_frac": 0.00018655580061022192,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6797820060483871,
      "model/head/update_ratio": 0.001049372018314898,
      "model/head/weight_delta": 4.715325355529785,
      "model/head/weight_delta_rel": 0.08272077143192291,
      "model/head/weight_norm": 57.56764221191406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41379132866859436,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4137168640786029,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4136577248573303,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2843101022731219,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07705795019865036,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05168530344963074,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5284034242021277,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016814093105494976,
      "model/modality_embedder.encoders.pose/weight_delta": 1.5203502178192139,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.04967458173632622,
      "model/modality_embedder.encoders.pose/weight_norm": 30.739274978637695,
      "model/modality_embedder/grad_frac": 0.07705795019865036,
      "model/modality_embedder/grad_norm": 0.05168530344963074,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5284034242021277,
      "model/modality_embedder/update_ratio": 0.0016814093105494976,
      "model/modality_embedder/weight_delta": 1.5203502178192139,
      "model/modality_embedder/weight_delta_rel": 0.04967458173632622,
      "model/modality_embedder/weight_norm": 30.739274978637695,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.24870300292969,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.142897145417308,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.023332595825195,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.216806223399994,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07930612564086914,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05319323018193245,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019287338946014643,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.8926196098327637,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03252759575843811,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.5793514251709,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.66291046142578,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.067108294930875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.55134105682373,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.851932777946823,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07045385986566544,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04725572466850281,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001622728887014091,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.1054308414459229,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.03829298913478851,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.121145248413086,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.2551040649414,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.757731161461,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.96015739440918,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.013744639686973,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07078013569116592,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04747456684708595,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015797008527442813,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.172912359237671,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.03938420116901398,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.05288314819336,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.6563491821289,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.698423365762075,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.083674430847168,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.347406491529348,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08126350492238998,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05450610816478729,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001850253902375698,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.0012364387512207,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.034217510372400284,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.458717346191406,
      "model/normalizer/grad_frac": 0.33805984258651733,
      "model/normalizer/grad_norm": 0.22674787044525146,
      "model/normalizer/grad_zero_frac": 0.00016662511916365474,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0029097117949277163,
      "model/normalizer/weight_delta": 2.1476407051086426,
      "model/normalizer/weight_delta_rel": 0.027660368010401726,
      "model/normalizer/weight_norm": 77.92794799804688,
      "pose_mae_dtheta": 0.24272651970386505,
      "pose_mae_dx": 0.09303956478834152,
      "pose_mae_dy": 0.0393683984875679,
      "pose_rmse_dtheta": 0.4220917224884033,
      "pose_rmse_dx": 0.2275184690952301,
      "pose_rmse_dy": 0.09074395895004272,
      "pose_rmse_mean": 0.24678471684455872,
      "rmse_dtheta": 0.047921519726514816,
      "rmse_dx": 0.024639640003442764,
      "rmse_dy": 0.008785340003669262,
      "rmse_mean": 0.02711549960076809,
      "rotation_flip": 0.009976976551115513,
      "sparse_tokens": 22239.0,
      "step": 1725,
      "turn_loss": 0.25334349274635315,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.08018955584463855,
      "grad_norm": 0.4475233554840088,
      "learning_rate": 9.556363219153664e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.010521736927330494,
      "mae_dx": 0.0015169219113886356,
      "mae_dy": 0.0013282297877594829,
      "pose_mae_dtheta": 0.07640502601861954,
      "pose_mae_dx": 0.017175452783703804,
      "pose_mae_dy": 0.0225671399384737,
      "pose_rmse_dtheta": 0.22855187952518463,
      "pose_rmse_dx": 0.04207343980669975,
      "pose_rmse_dy": 0.053076595067977905,
      "pose_rmse_mean": 0.10790064185857773,
      "rmse_dtheta": 0.02747299149632454,
      "rmse_dx": 0.004762740805745125,
      "rmse_dy": 0.003023924771696329,
      "rmse_mean": 0.011753220111131668,
      "rotation_flip": 0.0035938904620707035,
      "sparse_tokens": 32137.0,
      "step": 1726,
      "turn_loss": 0.06757352501153946,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08023601561048133,
      "grad_norm": 0.6363949179649353,
      "learning_rate": 9.555818565306086e-06,
      "loss": 0.1328,
      "mae_dtheta": 0.011451317928731441,
      "mae_dx": 0.00238909013569355,
      "mae_dy": 0.002095661358907819,
      "pose_mae_dtheta": 0.07955179363489151,
      "pose_mae_dx": 0.02441536635160446,
      "pose_mae_dy": 0.02664417400956154,
      "pose_rmse_dtheta": 0.22186194360256195,
      "pose_rmse_dx": 0.0617065392434597,
      "pose_rmse_dy": 0.059991560876369476,
      "pose_rmse_mean": 0.11452001333236694,
      "rmse_dtheta": 0.027416281402111053,
      "rmse_dx": 0.007166454568505287,
      "rmse_dy": 0.005180066917091608,
      "rmse_mean": 0.01325426809489727,
      "rotation_flip": 0.006211180239915848,
      "sparse_tokens": 32121.0,
      "step": 1727,
      "turn_loss": 0.08866380155086517,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0802824753763241,
      "grad_norm": 0.3660036027431488,
      "learning_rate": 9.55527359286767e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.007516046054661274,
      "mae_dx": 0.0011738233733922243,
      "mae_dy": 0.0011697105364874005,
      "pose_mae_dtheta": 0.05470576882362366,
      "pose_mae_dx": 0.014987066388130188,
      "pose_mae_dy": 0.01954852044582367,
      "pose_rmse_dtheta": 0.17520064115524292,
      "pose_rmse_dx": 0.04304487258195877,
      "pose_rmse_dy": 0.04623007774353027,
      "pose_rmse_mean": 0.08815853297710419,
      "rmse_dtheta": 0.020765768364071846,
      "rmse_dx": 0.0038673155941069126,
      "rmse_dy": 0.0029177898541092873,
      "rmse_mean": 0.009183624759316444,
      "rotation_flip": 0.0029513034969568253,
      "sparse_tokens": 32089.0,
      "step": 1728,
      "turn_loss": 0.05388100817799568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.08032893514216688,
      "grad_norm": 0.4636746346950531,
      "learning_rate": 9.554728301876525e-06,
      "loss": 0.1418,
      "mae_dtheta": 0.037510767579078674,
      "mae_dx": 0.013632175512611866,
      "mae_dy": 0.005647741258144379,
      "pose_mae_dtheta": 0.2991263270378113,
      "pose_mae_dx": 0.11816506087779999,
      "pose_mae_dy": 0.06982597708702087,
      "pose_rmse_dtheta": 0.46796083450317383,
      "pose_rmse_dx": 0.20961545407772064,
      "pose_rmse_dy": 0.17735439538955688,
      "pose_rmse_mean": 0.28497689962387085,
      "rmse_dtheta": 0.056192584335803986,
      "rmse_dx": 0.02413886971771717,
      "rmse_dy": 0.011750595644116402,
      "rmse_mean": 0.030694015324115753,
      "rotation_flip": 0.010033444501459599,
      "sparse_tokens": 4642.0,
      "step": 1729,
      "turn_loss": 0.34923988580703735,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.08037539490800967,
      "grad_norm": 0.7963742613792419,
      "learning_rate": 9.554182692370789e-06,
      "loss": 0.2031,
      "mae_dtheta": 0.03437037765979767,
      "mae_dx": 0.014775266870856285,
      "mae_dy": 0.004949843976646662,
      "pose_mae_dtheta": 0.2574220299720764,
      "pose_mae_dx": 0.1268390715122223,
      "pose_mae_dy": 0.05613735690712929,
      "pose_rmse_dtheta": 0.4469880759716034,
      "pose_rmse_dx": 0.25764432549476624,
      "pose_rmse_dy": 0.1278841346502304,
      "pose_rmse_mean": 0.2775055170059204,
      "rmse_dtheta": 0.051878079771995544,
      "rmse_dx": 0.02756967581808567,
      "rmse_dy": 0.010554072447121143,
      "rmse_mean": 0.030000610277056694,
      "rotation_flip": 0.005089058540761471,
      "sparse_tokens": 21185.0,
      "step": 1730,
      "turn_loss": 0.33976343274116516,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 12999.0,
      "epoch": 0.08042185467385245,
      "grad_norm": 1.0163096189498901,
      "learning_rate": 9.55363676438861e-06,
      "loss": 0.1801,
      "mae_dtheta": 0.023218199610710144,
      "mae_dx": 0.006747560575604439,
      "mae_dy": 0.003745268564671278,
      "pose_mae_dtheta": 0.15755531191825867,
      "pose_mae_dx": 0.05152721703052521,
      "pose_mae_dy": 0.056672628968954086,
      "pose_rmse_dtheta": 0.27037912607192993,
      "pose_rmse_dx": 0.12760663032531738,
      "pose_rmse_dy": 0.12212114036083221,
      "pose_rmse_mean": 0.17336897552013397,
      "rmse_dtheta": 0.037811025977134705,
      "rmse_dx": 0.01789966970682144,
      "rmse_dy": 0.006656712386757135,
      "rmse_mean": 0.020789137110114098,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 10344.0,
      "step": 1731,
      "turn_loss": 0.18432901799678802,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.08046831443969522,
      "grad_norm": 0.40762975811958313,
      "learning_rate": 9.553090517968168e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.035205721855163574,
      "mae_dx": 0.008389422670006752,
      "mae_dy": 0.0036868355236947536,
      "pose_mae_dtheta": 0.2819564938545227,
      "pose_mae_dx": 0.06755336374044418,
      "pose_mae_dy": 0.04020458459854126,
      "pose_rmse_dtheta": 0.5124239921569824,
      "pose_rmse_dx": 0.13304926455020905,
      "pose_rmse_dy": 0.09038986265659332,
      "pose_rmse_mean": 0.2452877014875412,
      "rmse_dtheta": 0.053916674107313156,
      "rmse_dx": 0.01605391316115856,
      "rmse_dy": 0.007975658401846886,
      "rmse_mean": 0.0259820818901062,
      "rotation_flip": 0.017699114978313446,
      "sparse_tokens": 5712.0,
      "step": 1732,
      "turn_loss": 0.2318408340215683,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.080514774205538,
      "grad_norm": 0.4108593761920929,
      "learning_rate": 9.552543953147664e-06,
      "loss": 0.1133,
      "mae_dtheta": 0.0085425591096282,
      "mae_dx": 0.0018518837168812752,
      "mae_dy": 0.0018110271776095033,
      "pose_mae_dtheta": 0.05569146201014519,
      "pose_mae_dx": 0.02057264745235443,
      "pose_mae_dy": 0.02155802957713604,
      "pose_rmse_dtheta": 0.15435737371444702,
      "pose_rmse_dx": 0.05717706307768822,
      "pose_rmse_dy": 0.05144081264734268,
      "pose_rmse_mean": 0.08765842020511627,
      "rmse_dtheta": 0.02047528699040413,
      "rmse_dx": 0.005835137329995632,
      "rmse_dy": 0.004346129018813372,
      "rmse_mean": 0.010218851268291473,
      "rotation_flip": 0.005512678995728493,
      "sparse_tokens": 32089.0,
      "step": 1733,
      "turn_loss": 0.069362111389637,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.08056123397138078,
      "grad_norm": 0.6747958660125732,
      "learning_rate": 9.551997069965316e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.010728564113378525,
      "mae_dx": 0.0019416830036789179,
      "mae_dy": 0.0023928768932819366,
      "pose_mae_dtheta": 0.07550258189439774,
      "pose_mae_dx": 0.02326192893087864,
      "pose_mae_dy": 0.031355176120996475,
      "pose_rmse_dtheta": 0.14716117084026337,
      "pose_rmse_dx": 0.05269589647650719,
      "pose_rmse_dy": 0.06928306072950363,
      "pose_rmse_mean": 0.08971337974071503,
      "rmse_dtheta": 0.020198259502649307,
      "rmse_dx": 0.005453376565128565,
      "rmse_dy": 0.0047096069902181625,
      "rmse_mean": 0.010120414197444916,
      "rotation_flip": 0.005065123084932566,
      "sparse_tokens": 32137.0,
      "step": 1734,
      "turn_loss": 0.07254499197006226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.08060769373722357,
      "grad_norm": 0.47623881697654724,
      "learning_rate": 9.551449868459371e-06,
      "loss": 0.126,
      "mae_dtheta": 0.010227011516690254,
      "mae_dx": 0.0016739959828555584,
      "mae_dy": 0.0022348000202327967,
      "pose_mae_dtheta": 0.07782246917486191,
      "pose_mae_dx": 0.019075006246566772,
      "pose_mae_dy": 0.02743505872786045,
      "pose_rmse_dtheta": 0.2240188866853714,
      "pose_rmse_dx": 0.05755472928285599,
      "pose_rmse_dy": 0.07117700576782227,
      "pose_rmse_mean": 0.11758354306221008,
      "rmse_dtheta": 0.024465348571538925,
      "rmse_dx": 0.0056344810873270035,
      "rmse_dy": 0.005393645726144314,
      "rmse_mean": 0.011831158772110939,
      "rotation_flip": 0.006520726718008518,
      "sparse_tokens": 32073.0,
      "step": 1735,
      "turn_loss": 0.09349480271339417,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.08065415350306634,
      "grad_norm": 0.4756326377391815,
      "learning_rate": 9.550902348668093e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.009414209052920341,
      "mae_dx": 0.0015963093610480428,
      "mae_dy": 0.0006649040151387453,
      "pose_mae_dtheta": 0.07239935547113419,
      "pose_mae_dx": 0.013547963462769985,
      "pose_mae_dy": 0.011324023827910423,
      "pose_rmse_dtheta": 0.2658851444721222,
      "pose_rmse_dx": 0.03545572608709335,
      "pose_rmse_dy": 0.02729380503296852,
      "pose_rmse_mean": 0.10954489558935165,
      "rmse_dtheta": 0.02961968630552292,
      "rmse_dx": 0.004630522336810827,
      "rmse_dy": 0.0014683495974168181,
      "rmse_mean": 0.011906186118721962,
      "rotation_flip": 0.0025316455867141485,
      "sparse_tokens": 32185.0,
      "step": 1736,
      "turn_loss": 0.04578369855880737,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2632.0,
      "epoch": 0.08070061326890912,
      "grad_norm": 0.4942334294319153,
      "learning_rate": 9.550354510629772e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.02206563577055931,
      "mae_dx": 0.013901817612349987,
      "mae_dy": 0.008504321798682213,
      "pose_mae_dtheta": 0.15041111409664154,
      "pose_mae_dx": 0.04345308244228363,
      "pose_mae_dy": 0.08124204725027084,
      "pose_rmse_dtheta": 0.22449319064617157,
      "pose_rmse_dx": 0.09719718992710114,
      "pose_rmse_dy": 0.21267808973789215,
      "pose_rmse_mean": 0.17812281847000122,
      "rmse_dtheta": 0.03283841907978058,
      "rmse_dx": 0.024017227813601494,
      "rmse_dy": 0.01656726747751236,
      "rmse_mean": 0.024474306032061577,
      "rotation_flip": 0.0,
      "sparse_tokens": 2368.0,
      "step": 1737,
      "turn_loss": 0.2623874545097351,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.0807470730347519,
      "grad_norm": 0.48231667280197144,
      "learning_rate": 9.549806354382716e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.013829042203724384,
      "mae_dx": 0.002310901414602995,
      "mae_dy": 0.0031765124294906855,
      "pose_mae_dtheta": 0.09212776273488998,
      "pose_mae_dx": 0.028997506946325302,
      "pose_mae_dy": 0.03641173616051674,
      "pose_rmse_dtheta": 0.1928696483373642,
      "pose_rmse_dx": 0.06889724731445312,
      "pose_rmse_dy": 0.076600581407547,
      "pose_rmse_mean": 0.11278916895389557,
      "rmse_dtheta": 0.024634381756186485,
      "rmse_dx": 0.006413035560399294,
      "rmse_dy": 0.006117884069681168,
      "rmse_mean": 0.012388433329761028,
      "rotation_flip": 0.008450704626739025,
      "sparse_tokens": 32105.0,
      "step": 1738,
      "turn_loss": 0.1011282280087471,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.08079353280059469,
      "grad_norm": 0.9054902195930481,
      "learning_rate": 9.54925787996526e-06,
      "loss": 0.2755,
      "mae_dtheta": 0.04247283935546875,
      "mae_dx": 0.016384219750761986,
      "mae_dy": 0.008009369485080242,
      "pose_mae_dtheta": 0.36323052644729614,
      "pose_mae_dx": 0.13355454802513123,
      "pose_mae_dy": 0.07497519999742508,
      "pose_rmse_dtheta": 0.5141856074333191,
      "pose_rmse_dx": 0.27152788639068604,
      "pose_rmse_dy": 0.1678236424922943,
      "pose_rmse_mean": 0.3178457021713257,
      "rmse_dtheta": 0.05411730706691742,
      "rmse_dx": 0.02870464138686657,
      "rmse_dy": 0.01336656790226698,
      "rmse_mean": 0.0320628397166729,
      "rotation_flip": 0.016949152573943138,
      "sparse_tokens": 3763.0,
      "step": 1739,
      "turn_loss": 0.4688212275505066,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08083999256643747,
      "grad_norm": 0.6209647059440613,
      "learning_rate": 9.548709087415762e-06,
      "loss": 0.1553,
      "mae_dtheta": 0.014367216266691685,
      "mae_dx": 0.002562233479693532,
      "mae_dy": 0.0033714103046804667,
      "pose_mae_dtheta": 0.09806565940380096,
      "pose_mae_dx": 0.037465326488018036,
      "pose_mae_dy": 0.04070592671632767,
      "pose_rmse_dtheta": 0.20984722673892975,
      "pose_rmse_dx": 0.08710429817438126,
      "pose_rmse_dy": 0.09348992258310318,
      "pose_rmse_mean": 0.13014715909957886,
      "rmse_dtheta": 0.026457777246832848,
      "rmse_dx": 0.006311614532023668,
      "rmse_dy": 0.00773851340636611,
      "rmse_mean": 0.013502635061740875,
      "rotation_flip": 0.007536827586591244,
      "sparse_tokens": 32121.0,
      "step": 1740,
      "turn_loss": 0.1194571703672409,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.08088645233228024,
      "grad_norm": 0.546553373336792,
      "learning_rate": 9.548159976772593e-06,
      "loss": 0.0892,
      "mae_dtheta": 0.006031762808561325,
      "mae_dx": 0.0015426422469317913,
      "mae_dy": 0.0008774285088293254,
      "pose_mae_dtheta": 0.04395915940403938,
      "pose_mae_dx": 0.013696270994842052,
      "pose_mae_dy": 0.011552256532013416,
      "pose_rmse_dtheta": 0.1233949288725853,
      "pose_rmse_dx": 0.03385072574019432,
      "pose_rmse_dy": 0.027780607342720032,
      "pose_rmse_mean": 0.06167542189359665,
      "rmse_dtheta": 0.018145829439163208,
      "rmse_dx": 0.004528259392827749,
      "rmse_dy": 0.0019150302978232503,
      "rmse_mean": 0.008196373470127583,
      "rotation_flip": 0.0004490345891099423,
      "sparse_tokens": 32201.0,
      "step": 1741,
      "turn_loss": 0.04684905335307121,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08093291209812302,
      "grad_norm": 0.39308902621269226,
      "learning_rate": 9.547610548074155e-06,
      "loss": 0.1006,
      "mae_dtheta": 0.011336053721606731,
      "mae_dx": 0.0016432595439255238,
      "mae_dy": 0.0027554407715797424,
      "pose_mae_dtheta": 0.08149964362382889,
      "pose_mae_dx": 0.024522172287106514,
      "pose_mae_dy": 0.03286777809262276,
      "pose_rmse_dtheta": 0.2118697613477707,
      "pose_rmse_dx": 0.0710291638970375,
      "pose_rmse_dy": 0.10068275779485703,
      "pose_rmse_mean": 0.12786057591438293,
      "rmse_dtheta": 0.024759167805314064,
      "rmse_dx": 0.004431311506778002,
      "rmse_dy": 0.007452019490301609,
      "rmse_mean": 0.012214167043566704,
      "rotation_flip": 0.011948907747864723,
      "sparse_tokens": 32089.0,
      "step": 1742,
      "turn_loss": 0.08108984678983688,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.08097937186396581,
      "grad_norm": 0.5352959036827087,
      "learning_rate": 9.547060801358873e-06,
      "loss": 0.1695,
      "mae_dtheta": 0.04556606709957123,
      "mae_dx": 0.010485291481018066,
      "mae_dy": 0.004670245107263327,
      "pose_mae_dtheta": 0.35401156544685364,
      "pose_mae_dx": 0.09496141225099564,
      "pose_mae_dy": 0.06371531635522842,
      "pose_rmse_dtheta": 0.6379791498184204,
      "pose_rmse_dx": 0.21655525267124176,
      "pose_rmse_dy": 0.18327711522579193,
      "pose_rmse_mean": 0.34593719244003296,
      "rmse_dtheta": 0.06784245371818542,
      "rmse_dx": 0.02348201349377632,
      "rmse_dy": 0.010181205347180367,
      "rmse_mean": 0.03383522480726242,
      "rotation_flip": 0.009324009530246258,
      "sparse_tokens": 7753.0,
      "step": 1743,
      "turn_loss": 0.33659860491752625,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.08102583162980859,
      "grad_norm": 0.6164284944534302,
      "learning_rate": 9.546510736665186e-06,
      "loss": 0.1285,
      "mae_dtheta": 0.007694394327700138,
      "mae_dx": 0.0018240129575133324,
      "mae_dy": 0.002219639252871275,
      "pose_mae_dtheta": 0.05618707463145256,
      "pose_mae_dx": 0.021623941138386726,
      "pose_mae_dy": 0.025633297860622406,
      "pose_rmse_dtheta": 0.1251002997159958,
      "pose_rmse_dx": 0.056306272745132446,
      "pose_rmse_dy": 0.07270638644695282,
      "pose_rmse_mean": 0.08470432460308075,
      "rmse_dtheta": 0.017640676349401474,
      "rmse_dx": 0.00496049365028739,
      "rmse_dy": 0.005829253699630499,
      "rmse_mean": 0.009476808831095695,
      "rotation_flip": 0.002421307610347867,
      "sparse_tokens": 32169.0,
      "step": 1744,
      "turn_loss": 0.07685874402523041,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.08107229139565136,
      "grad_norm": 0.45673543214797974,
      "learning_rate": 9.545960354031564e-06,
      "loss": 0.117,
      "mae_dtheta": 0.016014527529478073,
      "mae_dx": 0.002329885261133313,
      "mae_dy": 0.0045831771567463875,
      "pose_mae_dtheta": 0.10887599736452103,
      "pose_mae_dx": 0.03961045295000076,
      "pose_mae_dy": 0.05607903376221657,
      "pose_rmse_dtheta": 0.2074345201253891,
      "pose_rmse_dx": 0.09556005150079727,
      "pose_rmse_dy": 0.12407714873552322,
      "pose_rmse_mean": 0.1423572450876236,
      "rmse_dtheta": 0.028386041522026062,
      "rmse_dx": 0.006166852544993162,
      "rmse_dy": 0.00919304322451353,
      "rmse_mean": 0.014581980183720589,
      "rotation_flip": 0.0075601376593112946,
      "sparse_tokens": 32057.0,
      "step": 1745,
      "turn_loss": 0.1504221260547638,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.08111875116149414,
      "grad_norm": 0.5679123401641846,
      "learning_rate": 9.545409653496496e-06,
      "loss": 0.1539,
      "mae_dtheta": 0.03520936146378517,
      "mae_dx": 0.007540800143033266,
      "mae_dy": 0.003387966426089406,
      "pose_mae_dtheta": 0.3084222972393036,
      "pose_mae_dx": 0.06657290458679199,
      "pose_mae_dy": 0.045587122440338135,
      "pose_rmse_dtheta": 0.4984268546104431,
      "pose_rmse_dx": 0.15148334205150604,
      "pose_rmse_dy": 0.11300453543663025,
      "pose_rmse_mean": 0.2543049454689026,
      "rmse_dtheta": 0.05287003889679909,
      "rmse_dx": 0.016985461115837097,
      "rmse_dy": 0.009177393279969692,
      "rmse_mean": 0.0263442974537611,
      "rotation_flip": 0.01672862470149994,
      "sparse_tokens": 9872.0,
      "step": 1746,
      "turn_loss": 0.2771591544151306,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.08116521092733693,
      "grad_norm": 0.6305587887763977,
      "learning_rate": 9.544858635098491e-06,
      "loss": 0.1259,
      "mae_dtheta": 0.013402005657553673,
      "mae_dx": 0.0026630526408553123,
      "mae_dy": 0.003917698748409748,
      "pose_mae_dtheta": 0.08791778236627579,
      "pose_mae_dx": 0.03259700536727905,
      "pose_mae_dy": 0.046109940856695175,
      "pose_rmse_dtheta": 0.1851857602596283,
      "pose_rmse_dx": 0.07626812905073166,
      "pose_rmse_dy": 0.12304569035768509,
      "pose_rmse_mean": 0.12816652655601501,
      "rmse_dtheta": 0.02714933454990387,
      "rmse_dx": 0.007832735776901245,
      "rmse_dy": 0.008785378187894821,
      "rmse_mean": 0.014589149504899979,
      "rotation_flip": 0.012504342012107372,
      "sparse_tokens": 32137.0,
      "step": 1747,
      "turn_loss": 0.14503507316112518,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.08121167069317971,
      "grad_norm": 0.518557071685791,
      "learning_rate": 9.54430729887608e-06,
      "loss": 0.1485,
      "mae_dtheta": 0.03128046914935112,
      "mae_dx": 0.013736811466515064,
      "mae_dy": 0.0029297368600964546,
      "pose_mae_dtheta": 0.26377466320991516,
      "pose_mae_dx": 0.10992136597633362,
      "pose_mae_dy": 0.04883292689919472,
      "pose_rmse_dtheta": 0.4919012486934662,
      "pose_rmse_dx": 0.26813364028930664,
      "pose_rmse_dy": 0.11303471773862839,
      "pose_rmse_mean": 0.29102322459220886,
      "rmse_dtheta": 0.049060724675655365,
      "rmse_dx": 0.02819809690117836,
      "rmse_dy": 0.005695480853319168,
      "rmse_mean": 0.027651434764266014,
      "rotation_flip": 0.01645338162779808,
      "sparse_tokens": 10339.0,
      "step": 1748,
      "turn_loss": 0.17201490700244904,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.08125813045902248,
      "grad_norm": 0.47965675592422485,
      "learning_rate": 9.543755644867823e-06,
      "loss": 0.0844,
      "mae_dtheta": 0.006379321217536926,
      "mae_dx": 0.0014693096745759249,
      "mae_dy": 0.0009895783150568604,
      "pose_mae_dtheta": 0.045805543661117554,
      "pose_mae_dx": 0.015911299735307693,
      "pose_mae_dy": 0.012854225002229214,
      "pose_rmse_dtheta": 0.16746139526367188,
      "pose_rmse_dx": 0.03979628533124924,
      "pose_rmse_dy": 0.03934643790125847,
      "pose_rmse_mean": 0.08220137655735016,
      "rmse_dtheta": 0.020386895164847374,
      "rmse_dx": 0.0041145640425384045,
      "rmse_dy": 0.00259545654989779,
      "rmse_mean": 0.00903230533003807,
      "rotation_flip": 0.0030045066960155964,
      "sparse_tokens": 32153.0,
      "step": 1749,
      "turn_loss": 0.047659870237112045,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.08130459022486526,
      "grad_norm": 0.5856503248214722,
      "learning_rate": 9.543203673112294e-06,
      "loss": 0.1268,
      "mae_dtheta": 0.009768838062882423,
      "mae_dx": 0.0018524964107200503,
      "mae_dy": 0.001004659803584218,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5856503248214722,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.6747589111328,
      "model/head/act_norm_mean": 121.17009943181819,
      "model/head/act_norm_min": 58.32469177246094,
      "model/head/act_over_embed": 83.2692267418893,
      "model/head/grad_frac": 0.11561630666255951,
      "model/head/grad_norm": 0.06771072745323181,
      "model/head/grad_zero_frac": 0.00016720221901778132,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6794852825126263,
      "model/head/update_ratio": 0.0011760322377085686,
      "model/head/weight_delta": 4.751060962677002,
      "model/head/weight_delta_rel": 0.08334767818450928,
      "model/head/weight_norm": 57.57556915283203,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41380712389945984,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41375014934133975,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4136652648448944,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2843329762172962,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05601561442017555,
      "model/modality_embedder.encoders.pose/grad_norm": 0.032805562019348145,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5338264627659575,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001067140605300665,
      "model/modality_embedder.encoders.pose/weight_delta": 1.53471839427948,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05014403164386749,
      "model/modality_embedder.encoders.pose/weight_norm": 30.74155616760254,
      "model/modality_embedder/grad_frac": 0.05601561442017555,
      "model/modality_embedder/grad_norm": 0.032805562019348145,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5338264627659575,
      "model/modality_embedder/update_ratio": 0.001067140605300665,
      "model/modality_embedder/weight_delta": 1.53471839427948,
      "model/modality_embedder/weight_delta_rel": 0.05014403164386749,
      "model/modality_embedder/weight_norm": 30.74155616760254,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.64178466796875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.529466289882958,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.99001693725586,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.856878882889145,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10699766874313354,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06266321986913681,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002271895296871662,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.9027872085571289,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.032898109406232834,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.581912994384766,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.2724838256836,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.64745670995671,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.30898666381836,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.62517236635505,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09953148663043976,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.058290645480155945,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0020013288594782352,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.1190730333328247,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0387655645608902,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.12596893310547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.06197357177734,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.601486091069425,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.085597038269043,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.967999650967,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09703126549720764,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0568263940513134,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018905972829088569,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.1878693103790283,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.03988642618060112,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.057376861572266,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.8456802368164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.401026635401635,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.309529304504395,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.204660760596106,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10259560495615005,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.060085151344537735,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002039412036538124,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.0148062705993652,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03468126431107521,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.461997985839844,
      "model/normalizer/grad_frac": 0.40744534134864807,
      "model/normalizer/grad_norm": 0.23862050473690033,
      "model/normalizer/grad_zero_frac": 0.00018316945352125913,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0030618731398135424,
      "model/normalizer/weight_delta": 2.174539804458618,
      "model/normalizer/weight_delta_rel": 0.028006814420223236,
      "model/normalizer/weight_norm": 77.93285369873047,
      "pose_mae_dtheta": 0.07195567339658737,
      "pose_mae_dx": 0.015922771766781807,
      "pose_mae_dy": 0.010997477918863297,
      "pose_rmse_dtheta": 0.26639801263809204,
      "pose_rmse_dx": 0.040043171495199203,
      "pose_rmse_dy": 0.033018067479133606,
      "pose_rmse_mean": 0.11315308511257172,
      "rmse_dtheta": 0.030504923313856125,
      "rmse_dx": 0.005238622426986694,
      "rmse_dy": 0.0031894459389150143,
      "rmse_mean": 0.012977663427591324,
      "rotation_flip": 0.0031088083051145077,
      "sparse_tokens": 32201.0,
      "step": 1750,
      "turn_loss": 0.05432276427745819,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.08135104999070805,
      "grad_norm": 0.5730619430541992,
      "learning_rate": 9.542651383648092e-06,
      "loss": 0.1803,
      "mae_dtheta": 0.04175528138875961,
      "mae_dx": 0.0246216282248497,
      "mae_dy": 0.009417732246220112,
      "pose_mae_dtheta": 0.3805235028266907,
      "pose_mae_dx": 0.1877802163362503,
      "pose_mae_dy": 0.09882130473852158,
      "pose_rmse_dtheta": 0.6107592582702637,
      "pose_rmse_dx": 0.37320876121520996,
      "pose_rmse_dy": 0.2111910581588745,
      "pose_rmse_mean": 0.3983863592147827,
      "rmse_dtheta": 0.05786459147930145,
      "rmse_dx": 0.040093518793582916,
      "rmse_dy": 0.01510043628513813,
      "rmse_mean": 0.03768618404865265,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 2875.0,
      "step": 1751,
      "turn_loss": 0.4387941360473633,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 11667.0,
      "epoch": 0.08139750975655083,
      "grad_norm": 1.0550298690795898,
      "learning_rate": 9.542098776513842e-06,
      "loss": 0.2843,
      "mae_dtheta": 0.044917549937963486,
      "mae_dx": 0.020581670105457306,
      "mae_dy": 0.005049158353358507,
      "pose_mae_dtheta": 0.37969306111335754,
      "pose_mae_dx": 0.17287541925907135,
      "pose_mae_dy": 0.09353366494178772,
      "pose_rmse_dtheta": 0.575259268283844,
      "pose_rmse_dx": 0.3446063995361328,
      "pose_rmse_dy": 0.2040039598941803,
      "pose_rmse_mean": 0.37462323904037476,
      "rmse_dtheta": 0.060999393463134766,
      "rmse_dx": 0.03456101566553116,
      "rmse_dy": 0.009307636879384518,
      "rmse_mean": 0.03495601564645767,
      "rotation_flip": 0.01652892492711544,
      "sparse_tokens": 8936.0,
      "step": 1752,
      "turn_loss": 0.28421056270599365,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.0814439695223936,
      "grad_norm": 0.7083149552345276,
      "learning_rate": 9.541545851748186e-06,
      "loss": 0.1517,
      "mae_dtheta": 0.012076585553586483,
      "mae_dx": 0.0022341718431562185,
      "mae_dy": 0.0030337437056005,
      "pose_mae_dtheta": 0.08489375561475754,
      "pose_mae_dx": 0.027579322457313538,
      "pose_mae_dy": 0.03472881764173508,
      "pose_rmse_dtheta": 0.1806826889514923,
      "pose_rmse_dx": 0.06605401635169983,
      "pose_rmse_dy": 0.07642289996147156,
      "pose_rmse_mean": 0.10771986842155457,
      "rmse_dtheta": 0.022054852917790413,
      "rmse_dx": 0.006905959919095039,
      "rmse_dy": 0.006657825782895088,
      "rmse_mean": 0.011872880160808563,
      "rotation_flip": 0.005780346691608429,
      "sparse_tokens": 32057.0,
      "step": 1753,
      "turn_loss": 0.10220833867788315,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.08149042928823638,
      "grad_norm": 2.043017625808716,
      "learning_rate": 9.540992609389792e-06,
      "loss": 0.2417,
      "mae_dtheta": 0.03533191233873367,
      "mae_dx": 0.024484509602189064,
      "mae_dy": 0.0110488161444664,
      "pose_mae_dtheta": 0.29253849387168884,
      "pose_mae_dx": 0.21625445783138275,
      "pose_mae_dy": 0.14918343722820282,
      "pose_rmse_dtheta": 0.5011836886405945,
      "pose_rmse_dx": 0.3847928047180176,
      "pose_rmse_dy": 0.28202903270721436,
      "pose_rmse_mean": 0.38933515548706055,
      "rmse_dtheta": 0.05214462801814079,
      "rmse_dx": 0.038736388087272644,
      "rmse_dy": 0.020489532500505447,
      "rmse_mean": 0.03712351620197296,
      "rotation_flip": 0.013513513840734959,
      "sparse_tokens": 15793.0,
      "step": 1754,
      "turn_loss": 0.5033546686172485,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.08153688905407917,
      "grad_norm": 0.4182046353816986,
      "learning_rate": 9.540439049477349e-06,
      "loss": 0.0971,
      "mae_dtheta": 0.009981268085539341,
      "mae_dx": 0.0019785868935287,
      "mae_dy": 0.0023915793281048536,
      "pose_mae_dtheta": 0.0669284239411354,
      "pose_mae_dx": 0.021168721839785576,
      "pose_mae_dy": 0.029131967574357986,
      "pose_rmse_dtheta": 0.13460290431976318,
      "pose_rmse_dx": 0.05299612507224083,
      "pose_rmse_dy": 0.060769859701395035,
      "pose_rmse_mean": 0.08278962969779968,
      "rmse_dtheta": 0.018826346844434738,
      "rmse_dx": 0.0061257267370820045,
      "rmse_dy": 0.004482516087591648,
      "rmse_mean": 0.009811529889702797,
      "rotation_flip": 0.013049151748418808,
      "sparse_tokens": 32073.0,
      "step": 1755,
      "turn_loss": 0.08987326920032501,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4900.0,
      "epoch": 0.08158334881992195,
      "grad_norm": 0.48458415269851685,
      "learning_rate": 9.539885172049563e-06,
      "loss": 0.1347,
      "mae_dtheta": 0.027238868176937103,
      "mae_dx": 0.005764555651694536,
      "mae_dy": 0.0027575776912271976,
      "pose_mae_dtheta": 0.2127266824245453,
      "pose_mae_dx": 0.05061981827020645,
      "pose_mae_dy": 0.0491315983235836,
      "pose_rmse_dtheta": 0.36298230290412903,
      "pose_rmse_dx": 0.1220092847943306,
      "pose_rmse_dy": 0.12213776260614395,
      "pose_rmse_mean": 0.20237645506858826,
      "rmse_dtheta": 0.04423785209655762,
      "rmse_dx": 0.015998566523194313,
      "rmse_dy": 0.006748963613063097,
      "rmse_mean": 0.022328462451696396,
      "rotation_flip": 0.007936508394777775,
      "sparse_tokens": 4022.0,
      "step": 1756,
      "turn_loss": 0.13542243838310242,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.08162980858576473,
      "grad_norm": 0.5637359619140625,
      "learning_rate": 9.53933097714517e-06,
      "loss": 0.1156,
      "mae_dtheta": 0.03799515590071678,
      "mae_dx": 0.013652198016643524,
      "mae_dy": 0.004999876953661442,
      "pose_mae_dtheta": 0.2963801920413971,
      "pose_mae_dx": 0.10458766669034958,
      "pose_mae_dy": 0.05353257432579994,
      "pose_rmse_dtheta": 0.5283150672912598,
      "pose_rmse_dx": 0.21171921491622925,
      "pose_rmse_dy": 0.11521966755390167,
      "pose_rmse_mean": 0.28508466482162476,
      "rmse_dtheta": 0.057617414742708206,
      "rmse_dx": 0.025746235623955727,
      "rmse_dy": 0.010417149402201176,
      "rmse_mean": 0.03126026690006256,
      "rotation_flip": 0.014563106931746006,
      "sparse_tokens": 18678.0,
      "step": 1757,
      "turn_loss": 0.3113006353378296,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0816762683516075,
      "grad_norm": 0.6878139972686768,
      "learning_rate": 9.538776464802928e-06,
      "loss": 0.1529,
      "mae_dtheta": 0.009894505143165588,
      "mae_dx": 0.003469339106231928,
      "mae_dy": 0.0022832422982901335,
      "pose_mae_dtheta": 0.07257001847028732,
      "pose_mae_dx": 0.03643698990345001,
      "pose_mae_dy": 0.026209907606244087,
      "pose_rmse_dtheta": 0.17862868309020996,
      "pose_rmse_dx": 0.10536818951368332,
      "pose_rmse_dy": 0.06628049165010452,
      "pose_rmse_mean": 0.11675912141799927,
      "rmse_dtheta": 0.021501949056982994,
      "rmse_dx": 0.010313567705452442,
      "rmse_dy": 0.00540626235306263,
      "rmse_mean": 0.012407260946929455,
      "rotation_flip": 0.004098360426723957,
      "sparse_tokens": 32121.0,
      "step": 1758,
      "turn_loss": 0.09653271734714508,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.0817227281174503,
      "grad_norm": 0.6838845014572144,
      "learning_rate": 9.538221635061611e-06,
      "loss": 0.1319,
      "mae_dtheta": 0.01689976453781128,
      "mae_dx": 0.0028571237344294786,
      "mae_dy": 0.0032780845649540424,
      "pose_mae_dtheta": 0.11371742933988571,
      "pose_mae_dx": 0.037721119821071625,
      "pose_mae_dy": 0.04012294486165047,
      "pose_rmse_dtheta": 0.2457050383090973,
      "pose_rmse_dx": 0.08810825645923615,
      "pose_rmse_dy": 0.07977036386728287,
      "pose_rmse_mean": 0.1378612220287323,
      "rmse_dtheta": 0.031107477843761444,
      "rmse_dx": 0.007611662615090609,
      "rmse_dy": 0.006150885485112667,
      "rmse_mean": 0.014956675469875336,
      "rotation_flip": 0.005156411323696375,
      "sparse_tokens": 32137.0,
      "step": 1759,
      "turn_loss": 0.1350618153810501,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08176918788329307,
      "grad_norm": 0.49029862880706787,
      "learning_rate": 9.537666487960018e-06,
      "loss": 0.1395,
      "mae_dtheta": 0.011430107988417149,
      "mae_dx": 0.001690579578280449,
      "mae_dy": 0.002718697302043438,
      "pose_mae_dtheta": 0.08428233861923218,
      "pose_mae_dx": 0.01992928422987461,
      "pose_mae_dy": 0.03226129710674286,
      "pose_rmse_dtheta": 0.18304851651191711,
      "pose_rmse_dx": 0.04692515358328819,
      "pose_rmse_dy": 0.07280845195055008,
      "pose_rmse_mean": 0.10092737525701523,
      "rmse_dtheta": 0.022647526115179062,
      "rmse_dx": 0.004748957231640816,
      "rmse_dy": 0.006109566893428564,
      "rmse_mean": 0.011168683879077435,
      "rotation_flip": 0.0062720500864088535,
      "sparse_tokens": 32089.0,
      "step": 1760,
      "turn_loss": 0.09221622347831726,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.08181564764913585,
      "grad_norm": 0.49937739968299866,
      "learning_rate": 9.537111023536973e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.013220482505857944,
      "mae_dx": 0.0023481103125959635,
      "mae_dy": 0.0034476853907108307,
      "pose_mae_dtheta": 0.0922929123044014,
      "pose_mae_dx": 0.030644221231341362,
      "pose_mae_dy": 0.03697995841503143,
      "pose_rmse_dtheta": 0.21725940704345703,
      "pose_rmse_dx": 0.07181019335985184,
      "pose_rmse_dy": 0.08348554372787476,
      "pose_rmse_mean": 0.12418504804372787,
      "rmse_dtheta": 0.027747193351387978,
      "rmse_dx": 0.007213160861283541,
      "rmse_dy": 0.007324060890823603,
      "rmse_mean": 0.014094806276261806,
      "rotation_flip": 0.0077893175184726715,
      "sparse_tokens": 32057.0,
      "step": 1761,
      "turn_loss": 0.10863389074802399,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.08186210741497862,
      "grad_norm": 0.6946386098861694,
      "learning_rate": 9.53655524183132e-06,
      "loss": 0.1299,
      "mae_dtheta": 0.03132159635424614,
      "mae_dx": 0.008152765221893787,
      "mae_dy": 0.0038155040238052607,
      "pose_mae_dtheta": 0.2334422618150711,
      "pose_mae_dx": 0.06298034638166428,
      "pose_mae_dy": 0.04771208018064499,
      "pose_rmse_dtheta": 0.4435765743255615,
      "pose_rmse_dx": 0.1833922564983368,
      "pose_rmse_dy": 0.10419327020645142,
      "pose_rmse_mean": 0.24372071027755737,
      "rmse_dtheta": 0.05216466262936592,
      "rmse_dx": 0.020010406151413918,
      "rmse_dy": 0.006964430212974548,
      "rmse_mean": 0.026379834860563278,
      "rotation_flip": 0.015841584652662277,
      "sparse_tokens": 8818.0,
      "step": 1762,
      "turn_loss": 0.1981036514043808,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.08190856718082141,
      "grad_norm": 0.49586305022239685,
      "learning_rate": 9.535999142881923e-06,
      "loss": 0.1167,
      "mae_dtheta": 0.008735275827348232,
      "mae_dx": 0.0017263110494241118,
      "mae_dy": 0.0008300951449200511,
      "pose_mae_dtheta": 0.06132820248603821,
      "pose_mae_dx": 0.01589614525437355,
      "pose_mae_dy": 0.014780881814658642,
      "pose_rmse_dtheta": 0.2114352434873581,
      "pose_rmse_dx": 0.038504891097545624,
      "pose_rmse_dy": 0.04442765191197395,
      "pose_rmse_mean": 0.09812259674072266,
      "rmse_dtheta": 0.02636764943599701,
      "rmse_dx": 0.005270616617053747,
      "rmse_dy": 0.002379266545176506,
      "rmse_mean": 0.011339178308844566,
      "rotation_flip": 0.0043596732430160046,
      "sparse_tokens": 32153.0,
      "step": 1763,
      "turn_loss": 0.052084680646657944,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.08195502694666419,
      "grad_norm": 0.6177127957344055,
      "learning_rate": 9.53544272672767e-06,
      "loss": 0.1056,
      "mae_dtheta": 0.03131009638309479,
      "mae_dx": 0.005920058116316795,
      "mae_dy": 0.004989908076822758,
      "pose_mae_dtheta": 0.25902554392814636,
      "pose_mae_dx": 0.062081146985292435,
      "pose_mae_dy": 0.07161206007003784,
      "pose_rmse_dtheta": 0.4778217673301697,
      "pose_rmse_dx": 0.1314375400543213,
      "pose_rmse_dy": 0.14589707553386688,
      "pose_rmse_mean": 0.25171881914138794,
      "rmse_dtheta": 0.05052286759018898,
      "rmse_dx": 0.014918244443833828,
      "rmse_dy": 0.008556821383535862,
      "rmse_mean": 0.02466597780585289,
      "rotation_flip": 0.010989011265337467,
      "sparse_tokens": 14888.0,
      "step": 1764,
      "turn_loss": 0.21588902175426483,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.08200148671250697,
      "grad_norm": 0.5328521728515625,
      "learning_rate": 9.534885993407474e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.01067477185279131,
      "mae_dx": 0.001388602307997644,
      "mae_dy": 0.001969741890206933,
      "pose_mae_dtheta": 0.0827106386423111,
      "pose_mae_dx": 0.020788269117474556,
      "pose_mae_dy": 0.031592000275850296,
      "pose_rmse_dtheta": 0.20793567597866058,
      "pose_rmse_dx": 0.06557567417621613,
      "pose_rmse_dy": 0.08447316288948059,
      "pose_rmse_mean": 0.11932817101478577,
      "rmse_dtheta": 0.02354828454554081,
      "rmse_dx": 0.00437588756904006,
      "rmse_dy": 0.005156858824193478,
      "rmse_mean": 0.011027011089026928,
      "rotation_flip": 0.003180372528731823,
      "sparse_tokens": 32073.0,
      "step": 1765,
      "turn_loss": 0.08166763931512833,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.08204794647834975,
      "grad_norm": 1.0907737016677856,
      "learning_rate": 9.534328942960267e-06,
      "loss": 0.3189,
      "mae_dtheta": 0.03438318148255348,
      "mae_dx": 0.010601288639008999,
      "mae_dy": 0.005253488197922707,
      "pose_mae_dtheta": 0.2654660940170288,
      "pose_mae_dx": 0.11025204509496689,
      "pose_mae_dy": 0.06855510175228119,
      "pose_rmse_dtheta": 0.440894216299057,
      "pose_rmse_dx": 0.21937325596809387,
      "pose_rmse_dy": 0.14111457765102386,
      "pose_rmse_mean": 0.2671273648738861,
      "rmse_dtheta": 0.05023004487156868,
      "rmse_dx": 0.02213769406080246,
      "rmse_dy": 0.009054001420736313,
      "rmse_mean": 0.027140583842992783,
      "rotation_flip": 0.008146639913320541,
      "sparse_tokens": 8953.0,
      "step": 1766,
      "turn_loss": 0.22011065483093262,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08209440624419254,
      "grad_norm": 0.7148292660713196,
      "learning_rate": 9.533771575425001e-06,
      "loss": 0.098,
      "mae_dtheta": 0.011307207867503166,
      "mae_dx": 0.00224056513980031,
      "mae_dy": 0.0031054781284183264,
      "pose_mae_dtheta": 0.07728298753499985,
      "pose_mae_dx": 0.025599002838134766,
      "pose_mae_dy": 0.03238232806324959,
      "pose_rmse_dtheta": 0.16445878148078918,
      "pose_rmse_dx": 0.0683562308549881,
      "pose_rmse_dy": 0.07156011462211609,
      "pose_rmse_mean": 0.10145837068557739,
      "rmse_dtheta": 0.02283150888979435,
      "rmse_dx": 0.005994245409965515,
      "rmse_dy": 0.007329901214689016,
      "rmse_mean": 0.012051885947585106,
      "rotation_flip": 0.010265486314892769,
      "sparse_tokens": 32121.0,
      "step": 1767,
      "turn_loss": 0.11101896315813065,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 38938.0,
      "epoch": 0.08214086601003531,
      "grad_norm": 0.7430877685546875,
      "learning_rate": 9.533213890840657e-06,
      "loss": 0.1681,
      "mae_dtheta": 0.04072771593928337,
      "mae_dx": 0.011030043475329876,
      "mae_dy": 0.005225819535553455,
      "pose_mae_dtheta": 0.32398033142089844,
      "pose_mae_dx": 0.0898236557841301,
      "pose_mae_dy": 0.06350097805261612,
      "pose_rmse_dtheta": 0.572047233581543,
      "pose_rmse_dx": 0.19621571898460388,
      "pose_rmse_dy": 0.14824874699115753,
      "pose_rmse_mean": 0.3055039048194885,
      "rmse_dtheta": 0.05974452942609787,
      "rmse_dx": 0.022602416574954987,
      "rmse_dy": 0.010720089077949524,
      "rmse_mean": 0.031022345647215843,
      "rotation_flip": 0.012644889764487743,
      "sparse_tokens": 29938.0,
      "step": 1768,
      "turn_loss": 0.2749232351779938,
      "turns": 120.0,
      "turns_per_sample": 120.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.08218732577587809,
      "grad_norm": 0.7182785272598267,
      "learning_rate": 9.532655889246235e-06,
      "loss": 0.1011,
      "mae_dtheta": 0.008100311271846294,
      "mae_dx": 0.0024755941703915596,
      "mae_dy": 0.0018148301169276237,
      "pose_mae_dtheta": 0.06304037570953369,
      "pose_mae_dx": 0.022928928956389427,
      "pose_mae_dy": 0.02100321464240551,
      "pose_rmse_dtheta": 0.16233642399311066,
      "pose_rmse_dx": 0.07013209909200668,
      "pose_rmse_dy": 0.05313790962100029,
      "pose_rmse_mean": 0.09520214051008224,
      "rmse_dtheta": 0.020229823887348175,
      "rmse_dx": 0.008108722977340221,
      "rmse_dy": 0.006326936651021242,
      "rmse_mean": 0.011555161327123642,
      "rotation_flip": 0.002518891589716077,
      "sparse_tokens": 32057.0,
      "step": 1769,
      "turn_loss": 0.07075683772563934,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.08223378554172087,
      "grad_norm": 0.47075676918029785,
      "learning_rate": 9.53209757068075e-06,
      "loss": 0.13,
      "mae_dtheta": 0.034361861646175385,
      "mae_dx": 0.007967410609126091,
      "mae_dy": 0.004507595207542181,
      "pose_mae_dtheta": 0.26212531328201294,
      "pose_mae_dx": 0.06249641999602318,
      "pose_mae_dy": 0.06416300684213638,
      "pose_rmse_dtheta": 0.5209968686103821,
      "pose_rmse_dx": 0.1786993145942688,
      "pose_rmse_dy": 0.1789601743221283,
      "pose_rmse_mean": 0.2928854823112488,
      "rmse_dtheta": 0.05722418427467346,
      "rmse_dx": 0.019894815981388092,
      "rmse_dy": 0.00991736724972725,
      "rmse_mean": 0.029012124985456467,
      "rotation_flip": 0.007082153111696243,
      "sparse_tokens": 15263.0,
      "step": 1770,
      "turn_loss": 0.20799465477466583,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 27254.0,
      "epoch": 0.08228024530756364,
      "grad_norm": 0.6425219178199768,
      "learning_rate": 9.531538935183252e-06,
      "loss": 0.1673,
      "mae_dtheta": 0.03185122460126877,
      "mae_dx": 0.01327266450971365,
      "mae_dy": 0.005077034700661898,
      "pose_mae_dtheta": 0.2753347158432007,
      "pose_mae_dx": 0.1111222431063652,
      "pose_mae_dy": 0.043272316455841064,
      "pose_rmse_dtheta": 0.4717957079410553,
      "pose_rmse_dx": 0.24247412383556366,
      "pose_rmse_dy": 0.10097227245569229,
      "pose_rmse_mean": 0.2717473804950714,
      "rmse_dtheta": 0.048375070095062256,
      "rmse_dx": 0.025579167529940605,
      "rmse_dy": 0.011874710209667683,
      "rmse_mean": 0.02860965207219124,
      "rotation_flip": 0.01711491495370865,
      "sparse_tokens": 20715.0,
      "step": 1771,
      "turn_loss": 0.2992517948150635,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.08232670507340643,
      "grad_norm": 0.6564909219741821,
      "learning_rate": 9.530979982792801e-06,
      "loss": 0.1504,
      "mae_dtheta": 0.03160959109663963,
      "mae_dx": 0.009747534058988094,
      "mae_dy": 0.004364255350083113,
      "pose_mae_dtheta": 0.25301027297973633,
      "pose_mae_dx": 0.08488453179597855,
      "pose_mae_dy": 0.056813374161720276,
      "pose_rmse_dtheta": 0.4832625687122345,
      "pose_rmse_dx": 0.2222512662410736,
      "pose_rmse_dy": 0.14586873352527618,
      "pose_rmse_mean": 0.28379419445991516,
      "rmse_dtheta": 0.05126224830746651,
      "rmse_dx": 0.022829413414001465,
      "rmse_dy": 0.009330250322818756,
      "rmse_mean": 0.02780730277299881,
      "rotation_flip": 0.011709601618349552,
      "sparse_tokens": 14724.0,
      "step": 1772,
      "turn_loss": 0.26781076192855835,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.08237316483924921,
      "grad_norm": 0.7547541260719299,
      "learning_rate": 9.530420713548489e-06,
      "loss": 0.1532,
      "mae_dtheta": 0.039216067641973495,
      "mae_dx": 0.011869861744344234,
      "mae_dy": 0.005857901647686958,
      "pose_mae_dtheta": 0.3385465443134308,
      "pose_mae_dx": 0.1072307750582695,
      "pose_mae_dy": 0.09911785274744034,
      "pose_rmse_dtheta": 0.6079911589622498,
      "pose_rmse_dx": 0.25249043107032776,
      "pose_rmse_dy": 0.23546598851680756,
      "pose_rmse_mean": 0.36531588435173035,
      "rmse_dtheta": 0.060469310730695724,
      "rmse_dx": 0.02604329027235508,
      "rmse_dy": 0.011575314216315746,
      "rmse_mean": 0.03269597142934799,
      "rotation_flip": 0.0021413275972008705,
      "sparse_tokens": 10699.0,
      "step": 1773,
      "turn_loss": 0.25224563479423523,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.08241962460509199,
      "grad_norm": 0.552639365196228,
      "learning_rate": 9.529861127489426e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.014583162032067776,
      "mae_dx": 0.0034197093918919563,
      "mae_dy": 0.0037852765526622534,
      "pose_mae_dtheta": 0.11212185025215149,
      "pose_mae_dx": 0.04161617532372475,
      "pose_mae_dy": 0.041580330580472946,
      "pose_rmse_dtheta": 0.2779615521430969,
      "pose_rmse_dx": 0.10901320725679398,
      "pose_rmse_dy": 0.10339074581861496,
      "pose_rmse_mean": 0.16345517337322235,
      "rmse_dtheta": 0.031138619408011436,
      "rmse_dx": 0.010160173289477825,
      "rmse_dy": 0.009467752650380135,
      "rmse_mean": 0.016922181472182274,
      "rotation_flip": 0.003859348129481077,
      "sparse_tokens": 32073.0,
      "step": 1774,
      "turn_loss": 0.11209175735712051,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.08246608437093476,
      "grad_norm": 0.6765934228897095,
      "learning_rate": 9.529301224654744e-06,
      "loss": 0.193,
      "mae_dtheta": 0.011655041947960854,
      "mae_dx": 0.002240887377411127,
      "mae_dy": 0.0020694059785455465,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6765933036804199,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.11451721191406,
      "model/head/act_norm_mean": 108.86931818181819,
      "model/head/act_norm_min": 63.992523193359375,
      "model/head/act_over_embed": 74.81601470516082,
      "model/head/grad_frac": 0.09201287478208542,
      "model/head/grad_norm": 0.06225529685616493,
      "model/head/grad_zero_frac": 0.0001764031039783731,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6900795059974747,
      "model/head/update_ratio": 0.0010811076499521732,
      "model/head/weight_delta": 4.79126501083374,
      "model/head/weight_delta_rel": 0.08405297994613647,
      "model/head/weight_norm": 57.58473205566406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41390761733055115,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41384124755859375,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41376838088035583,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28439557976506813,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09568904340267181,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0647425651550293,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.528526135089686,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0021059492137283087,
      "model/modality_embedder.encoders.pose/weight_delta": 1.5443439483642578,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05045853182673454,
      "model/modality_embedder.encoders.pose/weight_norm": 30.742700576782227,
      "model/modality_embedder/grad_frac": 0.09568904340267181,
      "model/modality_embedder/grad_norm": 0.0647425651550293,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.528526135089686,
      "model/modality_embedder/update_ratio": 0.0021059492137283087,
      "model/modality_embedder/weight_delta": 1.5443439483642578,
      "model/modality_embedder/weight_delta_rel": 0.05045853182673454,
      "model/modality_embedder/weight_norm": 30.742700576782227,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.04281616210938,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.22860549943883,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.108835220336914,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.96291516884534,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08831451088190079,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05975300818681717,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0021661967039108276,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.9137438535690308,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.033297378569841385,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.584293365478516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.72554016113281,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.285736832611832,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.252127647399902,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.6893857180213,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08464252948760986,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05726856738328934,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.00196596747264266,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.1333482265472412,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.03926006704568863,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.129966735839844,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.73516082763672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.217893217893216,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.352161407470703,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.017181675119744,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08428221195936203,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05702478066086769,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018969826633110642,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.2028234004974365,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0403885580599308,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.060781478881836,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 82.92317962646484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.080865700657366,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.307915687561035,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.297433806698443,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0833372250199318,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05638540908694267,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019137185299769044,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.027298092842102,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03510817512869835,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.463794708251953,
      "model/normalizer/grad_frac": 0.35349082946777344,
      "model/normalizer/grad_norm": 0.23916953802108765,
      "model/normalizer/grad_zero_frac": 0.0001654433726798743,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003068765392526984,
      "model/normalizer/weight_delta": 2.2017102241516113,
      "model/normalizer/weight_delta_rel": 0.028356753289699554,
      "model/normalizer/weight_norm": 77.93672943115234,
      "pose_mae_dtheta": 0.08256983757019043,
      "pose_mae_dx": 0.028078975155949593,
      "pose_mae_dy": 0.03254258632659912,
      "pose_rmse_dtheta": 0.1880740225315094,
      "pose_rmse_dx": 0.07615399360656738,
      "pose_rmse_dy": 0.07418150454759598,
      "pose_rmse_mean": 0.11280317604541779,
      "rmse_dtheta": 0.023028364405035973,
      "rmse_dx": 0.007605303544551134,
      "rmse_dy": 0.004064992070198059,
      "rmse_mean": 0.011566219851374626,
      "rotation_flip": 0.001435750164091587,
      "sparse_tokens": 32105.0,
      "step": 1775,
      "turn_loss": 0.0813240259885788,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.08251254413677755,
      "grad_norm": 0.7619921565055847,
      "learning_rate": 9.528741005083593e-06,
      "loss": 0.1676,
      "mae_dtheta": 0.03017883561551571,
      "mae_dx": 0.014934740029275417,
      "mae_dy": 0.00873624812811613,
      "pose_mae_dtheta": 0.24902476370334625,
      "pose_mae_dx": 0.11271042376756668,
      "pose_mae_dy": 0.08469802141189575,
      "pose_rmse_dtheta": 0.4531816840171814,
      "pose_rmse_dx": 0.2374325692653656,
      "pose_rmse_dy": 0.16941361129283905,
      "pose_rmse_mean": 0.28667595982551575,
      "rmse_dtheta": 0.04696076735854149,
      "rmse_dx": 0.027767309918999672,
      "rmse_dy": 0.016178838908672333,
      "rmse_mean": 0.03030230663716793,
      "rotation_flip": 0.017241379246115685,
      "sparse_tokens": 8136.0,
      "step": 1776,
      "turn_loss": 0.39359942078590393,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.08255900390262033,
      "grad_norm": 0.612994372844696,
      "learning_rate": 9.528180468815155e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.010058928281068802,
      "mae_dx": 0.0017127414466813207,
      "mae_dy": 0.0009039822034537792,
      "pose_mae_dtheta": 0.07745376229286194,
      "pose_mae_dx": 0.015510861761868,
      "pose_mae_dy": 0.015790030360221863,
      "pose_rmse_dtheta": 0.26534363627433777,
      "pose_rmse_dx": 0.03885076195001602,
      "pose_rmse_dy": 0.042618535459041595,
      "pose_rmse_mean": 0.11560431122779846,
      "rmse_dtheta": 0.02914249524474144,
      "rmse_dx": 0.0049073160625994205,
      "rmse_dy": 0.001821455080062151,
      "rmse_mean": 0.01195708941668272,
      "rotation_flip": 0.002585315378382802,
      "sparse_tokens": 32153.0,
      "step": 1777,
      "turn_loss": 0.04817138984799385,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.08260546366846311,
      "grad_norm": 0.5174311995506287,
      "learning_rate": 9.527619615888625e-06,
      "loss": 0.1471,
      "mae_dtheta": 0.008811688981950283,
      "mae_dx": 0.0019937714096158743,
      "mae_dy": 0.0012571479892358184,
      "pose_mae_dtheta": 0.06475163251161575,
      "pose_mae_dx": 0.019791224971413612,
      "pose_mae_dy": 0.019819866865873337,
      "pose_rmse_dtheta": 0.15455879271030426,
      "pose_rmse_dx": 0.052967265248298645,
      "pose_rmse_dy": 0.05364760383963585,
      "pose_rmse_mean": 0.08705788850784302,
      "rmse_dtheta": 0.020305437967181206,
      "rmse_dx": 0.006672846153378487,
      "rmse_dy": 0.002935050055384636,
      "rmse_mean": 0.00997111201286316,
      "rotation_flip": 0.0030911900103092194,
      "sparse_tokens": 32105.0,
      "step": 1778,
      "turn_loss": 0.07283930480480194,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.08265192343430589,
      "grad_norm": 0.5956708788871765,
      "learning_rate": 9.527058446343226e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.00947500765323639,
      "mae_dx": 0.002163208555430174,
      "mae_dy": 0.001812387490645051,
      "pose_mae_dtheta": 0.06574533134698868,
      "pose_mae_dx": 0.022498829290270805,
      "pose_mae_dy": 0.0306794885545969,
      "pose_rmse_dtheta": 0.15115846693515778,
      "pose_rmse_dx": 0.07316022366285324,
      "pose_rmse_dy": 0.06916248798370361,
      "pose_rmse_mean": 0.09782706201076508,
      "rmse_dtheta": 0.019902022555470467,
      "rmse_dx": 0.008080958388745785,
      "rmse_dy": 0.0037784790620207787,
      "rmse_mean": 0.01058715395629406,
      "rotation_flip": 0.004289544187486172,
      "sparse_tokens": 32057.0,
      "step": 1779,
      "turn_loss": 0.07158838212490082,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08269838320014868,
      "grad_norm": 0.4999031126499176,
      "learning_rate": 9.526496960218201e-06,
      "loss": 0.1506,
      "mae_dtheta": 0.005415485240519047,
      "mae_dx": 0.001468000584281981,
      "mae_dy": 0.000546070106793195,
      "pose_mae_dtheta": 0.04140032082796097,
      "pose_mae_dx": 0.011984175071120262,
      "pose_mae_dy": 0.011135421693325043,
      "pose_rmse_dtheta": 0.13273799419403076,
      "pose_rmse_dx": 0.03657221421599388,
      "pose_rmse_dy": 0.026568865403532982,
      "pose_rmse_mean": 0.06529302895069122,
      "rmse_dtheta": 0.018566017970442772,
      "rmse_dx": 0.0048442417755723,
      "rmse_dy": 0.0010826302459463477,
      "rmse_mean": 0.00816429778933525,
      "rotation_flip": 0.0017513134516775608,
      "sparse_tokens": 32089.0,
      "step": 1780,
      "turn_loss": 0.038474030792713165,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32016.0,
      "epoch": 0.08274484296599145,
      "grad_norm": 0.4272947311401367,
      "learning_rate": 9.525935157552813e-06,
      "loss": 0.103,
      "mae_dtheta": 0.02827361412346363,
      "mae_dx": 0.011298103258013725,
      "mae_dy": 0.004137753043323755,
      "pose_mae_dtheta": 0.21231980621814728,
      "pose_mae_dx": 0.08016154915094376,
      "pose_mae_dy": 0.06225370988249779,
      "pose_rmse_dtheta": 0.42497146129608154,
      "pose_rmse_dx": 0.1883961409330368,
      "pose_rmse_dy": 0.13800902664661407,
      "pose_rmse_mean": 0.25045889616012573,
      "rmse_dtheta": 0.04662962257862091,
      "rmse_dx": 0.023688167333602905,
      "rmse_dy": 0.007927640341222286,
      "rmse_mean": 0.026081811636686325,
      "rotation_flip": 0.005865102633833885,
      "sparse_tokens": 26552.0,
      "step": 1781,
      "turn_loss": 0.22366130352020264,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.08279130273183423,
      "grad_norm": 0.6721665859222412,
      "learning_rate": 9.52537303838635e-06,
      "loss": 0.1971,
      "mae_dtheta": 0.02473021112382412,
      "mae_dx": 0.009104248136281967,
      "mae_dy": 0.005608874373137951,
      "pose_mae_dtheta": 0.21661236882209778,
      "pose_mae_dx": 0.10527428239583969,
      "pose_mae_dy": 0.09588844329118729,
      "pose_rmse_dtheta": 0.36677244305610657,
      "pose_rmse_dx": 0.2677759528160095,
      "pose_rmse_dy": 0.1433447003364563,
      "pose_rmse_mean": 0.2592977285385132,
      "rmse_dtheta": 0.0359230637550354,
      "rmse_dx": 0.024449795484542847,
      "rmse_dy": 0.0075141130946576595,
      "rmse_mean": 0.022628990933299065,
      "rotation_flip": 0.02259887009859085,
      "sparse_tokens": 3228.0,
      "step": 1782,
      "turn_loss": 0.2482842355966568,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.082837762497677,
      "grad_norm": 0.6384414434432983,
      "learning_rate": 9.524810602758122e-06,
      "loss": 0.1624,
      "mae_dtheta": 0.014976824633777142,
      "mae_dx": 0.002417480107396841,
      "mae_dy": 0.0040068733505904675,
      "pose_mae_dtheta": 0.09495828300714493,
      "pose_mae_dx": 0.03380884975194931,
      "pose_mae_dy": 0.04702330008149147,
      "pose_rmse_dtheta": 0.18149198591709137,
      "pose_rmse_dx": 0.0815248116850853,
      "pose_rmse_dy": 0.09832801669836044,
      "pose_rmse_mean": 0.1204482764005661,
      "rmse_dtheta": 0.027911143377423286,
      "rmse_dx": 0.007203985936939716,
      "rmse_dy": 0.008980841375887394,
      "rmse_mean": 0.01469865720719099,
      "rotation_flip": 0.009313556365668774,
      "sparse_tokens": 32073.0,
      "step": 1783,
      "turn_loss": 0.15499544143676758,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.0828842222635198,
      "grad_norm": 0.3374347984790802,
      "learning_rate": 9.52424785070746e-06,
      "loss": 0.0749,
      "mae_dtheta": 0.009077091701328754,
      "mae_dx": 0.0017825457034632564,
      "mae_dy": 0.0011341820936650038,
      "pose_mae_dtheta": 0.06725087761878967,
      "pose_mae_dx": 0.017139727249741554,
      "pose_mae_dy": 0.016604023054242134,
      "pose_rmse_dtheta": 0.21455997228622437,
      "pose_rmse_dx": 0.03833678364753723,
      "pose_rmse_dy": 0.04390360414981842,
      "pose_rmse_mean": 0.09893345832824707,
      "rmse_dtheta": 0.023741405457258224,
      "rmse_dx": 0.00529536884278059,
      "rmse_dy": 0.0025565302930772305,
      "rmse_mean": 0.010531101375818253,
      "rotation_flip": 0.0016467681853100657,
      "sparse_tokens": 32169.0,
      "step": 1784,
      "turn_loss": 0.05914231389760971,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.08293068202936257,
      "grad_norm": 0.5417793989181519,
      "learning_rate": 9.523684782273717e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.04470125585794449,
      "mae_dx": 0.022473353892564774,
      "mae_dy": 0.007896247319877148,
      "pose_mae_dtheta": 0.36447009444236755,
      "pose_mae_dx": 0.18639066815376282,
      "pose_mae_dy": 0.07491983473300934,
      "pose_rmse_dtheta": 0.5689136385917664,
      "pose_rmse_dx": 0.34601572155952454,
      "pose_rmse_dy": 0.1380997598171234,
      "pose_rmse_mean": 0.351009726524353,
      "rmse_dtheta": 0.06083386018872261,
      "rmse_dx": 0.03550457954406738,
      "rmse_dy": 0.012934739701449871,
      "rmse_mean": 0.036424390971660614,
      "rotation_flip": 0.024390242993831635,
      "sparse_tokens": 2819.0,
      "step": 1785,
      "turn_loss": 0.341165155172348,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.08297714179520535,
      "grad_norm": 0.5939967036247253,
      "learning_rate": 9.52312139749627e-06,
      "loss": 0.1387,
      "mae_dtheta": 0.0329551100730896,
      "mae_dx": 0.012338850647211075,
      "mae_dy": 0.005028015002608299,
      "pose_mae_dtheta": 0.27874621748924255,
      "pose_mae_dx": 0.0904669314622879,
      "pose_mae_dy": 0.06348580867052078,
      "pose_rmse_dtheta": 0.4628823399543762,
      "pose_rmse_dx": 0.18250681459903717,
      "pose_rmse_dy": 0.15442627668380737,
      "pose_rmse_mean": 0.2666051387786865,
      "rmse_dtheta": 0.0487898550927639,
      "rmse_dx": 0.024560250341892242,
      "rmse_dy": 0.009279829449951649,
      "rmse_mean": 0.027543311938643456,
      "rotation_flip": 0.007042253389954567,
      "sparse_tokens": 11876.0,
      "step": 1786,
      "turn_loss": 0.2811224162578583,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.08302360156104813,
      "grad_norm": 0.6952157616615295,
      "learning_rate": 9.522557696414516e-06,
      "loss": 0.182,
      "mae_dtheta": 0.03655245155096054,
      "mae_dx": 0.013713901862502098,
      "mae_dy": 0.004919776227325201,
      "pose_mae_dtheta": 0.30482348799705505,
      "pose_mae_dx": 0.11098957806825638,
      "pose_mae_dy": 0.059069033712148666,
      "pose_rmse_dtheta": 0.512965202331543,
      "pose_rmse_dx": 0.23418405652046204,
      "pose_rmse_dy": 0.13574346899986267,
      "pose_rmse_mean": 0.29429757595062256,
      "rmse_dtheta": 0.05361407250165939,
      "rmse_dx": 0.025765057653188705,
      "rmse_dy": 0.00909401848912239,
      "rmse_mean": 0.02949104830622673,
      "rotation_flip": 0.016835017129778862,
      "sparse_tokens": 25380.0,
      "step": 1787,
      "turn_loss": 0.2876233756542206,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 33414.0,
      "epoch": 0.08307006132689092,
      "grad_norm": 0.6447264552116394,
      "learning_rate": 9.521993679067873e-06,
      "loss": 0.2621,
      "mae_dtheta": 0.030044404789805412,
      "mae_dx": 0.011458545923233032,
      "mae_dy": 0.005454672034829855,
      "pose_mae_dtheta": 0.2297370284795761,
      "pose_mae_dx": 0.08809734135866165,
      "pose_mae_dy": 0.05989675596356392,
      "pose_rmse_dtheta": 0.3926432728767395,
      "pose_rmse_dx": 0.19831134378910065,
      "pose_rmse_dy": 0.16425207257270813,
      "pose_rmse_mean": 0.2517355680465698,
      "rmse_dtheta": 0.04618794471025467,
      "rmse_dx": 0.022676540538668633,
      "rmse_dy": 0.012892987579107285,
      "rmse_mean": 0.02725249156355858,
      "rotation_flip": 0.014350946061313152,
      "sparse_tokens": 26672.0,
      "step": 1788,
      "turn_loss": 0.276757150888443,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 20711.0,
      "epoch": 0.0831165210927337,
      "grad_norm": 0.7717366814613342,
      "learning_rate": 9.521429345495787e-06,
      "loss": 0.2776,
      "mae_dtheta": 0.035960085690021515,
      "mae_dx": 0.015161426737904549,
      "mae_dy": 0.00553865684196353,
      "pose_mae_dtheta": 0.3187357783317566,
      "pose_mae_dx": 0.13210870325565338,
      "pose_mae_dy": 0.09596230089664459,
      "pose_rmse_dtheta": 0.5268853306770325,
      "pose_rmse_dx": 0.2900358736515045,
      "pose_rmse_dy": 0.2031206488609314,
      "pose_rmse_mean": 0.3400139808654785,
      "rmse_dtheta": 0.05193544924259186,
      "rmse_dx": 0.029771713539958,
      "rmse_dy": 0.009905826300382614,
      "rmse_mean": 0.030537664890289307,
      "rotation_flip": 0.01013941690325737,
      "sparse_tokens": 16119.0,
      "step": 1789,
      "turn_loss": 0.2846148908138275,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.08316298085857647,
      "grad_norm": 0.6784791350364685,
      "learning_rate": 9.52086469573772e-06,
      "loss": 0.14,
      "mae_dtheta": 0.013331239111721516,
      "mae_dx": 0.0033030547201633453,
      "mae_dy": 0.0029169456101953983,
      "pose_mae_dtheta": 0.09360126405954361,
      "pose_mae_dx": 0.03779202699661255,
      "pose_mae_dy": 0.031037433072924614,
      "pose_rmse_dtheta": 0.22915419936180115,
      "pose_rmse_dx": 0.09923653304576874,
      "pose_rmse_dy": 0.0765860304236412,
      "pose_rmse_mean": 0.13499225676059723,
      "rmse_dtheta": 0.02749479003250599,
      "rmse_dx": 0.009148955345153809,
      "rmse_dy": 0.006372580770403147,
      "rmse_mean": 0.014338775537908077,
      "rotation_flip": 0.004346251487731934,
      "sparse_tokens": 32153.0,
      "step": 1790,
      "turn_loss": 0.10727372020483017,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.08320944062441925,
      "grad_norm": 0.779055655002594,
      "learning_rate": 9.520299729833157e-06,
      "loss": 0.2312,
      "mae_dtheta": 0.029989629983901978,
      "mae_dx": 0.008629740215837955,
      "mae_dy": 0.005892402492463589,
      "pose_mae_dtheta": 0.24601243436336517,
      "pose_mae_dx": 0.07511844485998154,
      "pose_mae_dy": 0.09508726000785828,
      "pose_rmse_dtheta": 0.38593965768814087,
      "pose_rmse_dx": 0.16814783215522766,
      "pose_rmse_dy": 0.20605839788913727,
      "pose_rmse_mean": 0.25338196754455566,
      "rmse_dtheta": 0.045792654156684875,
      "rmse_dx": 0.020253263413906097,
      "rmse_dy": 0.011887935921549797,
      "rmse_mean": 0.025977952405810356,
      "rotation_flip": 0.008219177834689617,
      "sparse_tokens": 6607.0,
      "step": 1791,
      "turn_loss": 0.20341768860816956,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.08325590039026204,
      "grad_norm": 0.48740074038505554,
      "learning_rate": 9.519734447821607e-06,
      "loss": 0.1524,
      "mae_dtheta": 0.011971976608037949,
      "mae_dx": 0.002424459205940366,
      "mae_dy": 0.0020552808418869972,
      "pose_mae_dtheta": 0.08637983351945877,
      "pose_mae_dx": 0.031169848516583443,
      "pose_mae_dy": 0.02882789447903633,
      "pose_rmse_dtheta": 0.23306719958782196,
      "pose_rmse_dx": 0.07996077835559845,
      "pose_rmse_dy": 0.06789431720972061,
      "pose_rmse_mean": 0.12697410583496094,
      "rmse_dtheta": 0.027974093332886696,
      "rmse_dx": 0.00734688388183713,
      "rmse_dy": 0.0045785983093082905,
      "rmse_mean": 0.013299859128892422,
      "rotation_flip": 0.005535983946174383,
      "sparse_tokens": 32057.0,
      "step": 1792,
      "turn_loss": 0.09763948619365692,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08330236015610482,
      "grad_norm": 0.5082373023033142,
      "learning_rate": 9.519168849742603e-06,
      "loss": 0.1093,
      "mae_dtheta": 0.01219653058797121,
      "mae_dx": 0.0038433580193668604,
      "mae_dy": 0.004592771641910076,
      "pose_mae_dtheta": 0.09022615849971771,
      "pose_mae_dx": 0.05133768543601036,
      "pose_mae_dy": 0.0455470010638237,
      "pose_rmse_dtheta": 0.1949915885925293,
      "pose_rmse_dx": 0.1604430377483368,
      "pose_rmse_dy": 0.13473546504974365,
      "pose_rmse_mean": 0.16339004039764404,
      "rmse_dtheta": 0.023632504045963287,
      "rmse_dx": 0.010940601117908955,
      "rmse_dy": 0.012199167162179947,
      "rmse_mean": 0.015590757131576538,
      "rotation_flip": 0.004111842252314091,
      "sparse_tokens": 32121.0,
      "step": 1793,
      "turn_loss": 0.15229587256908417,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.08334881992194759,
      "grad_norm": 0.5561684966087341,
      "learning_rate": 9.518602935635697e-06,
      "loss": 0.1132,
      "mae_dtheta": 0.033537525683641434,
      "mae_dx": 0.01688421703875065,
      "mae_dy": 0.007356973830610514,
      "pose_mae_dtheta": 0.24670089781284332,
      "pose_mae_dx": 0.13983969390392303,
      "pose_mae_dy": 0.08243029564619064,
      "pose_rmse_dtheta": 0.4140448272228241,
      "pose_rmse_dx": 0.27585887908935547,
      "pose_rmse_dy": 0.18126548826694489,
      "pose_rmse_mean": 0.290389746427536,
      "rmse_dtheta": 0.04881146922707558,
      "rmse_dx": 0.03020254522562027,
      "rmse_dy": 0.013903312385082245,
      "rmse_mean": 0.030972443521022797,
      "rotation_flip": 0.005369127728044987,
      "sparse_tokens": 13532.0,
      "step": 1794,
      "turn_loss": 0.2778950333595276,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.08339527968779037,
      "grad_norm": 0.34694626927375793,
      "learning_rate": 9.518036705540459e-06,
      "loss": 0.082,
      "mae_dtheta": 0.007812174502760172,
      "mae_dx": 0.0023761834017932415,
      "mae_dy": 0.001277556992135942,
      "pose_mae_dtheta": 0.06105754151940346,
      "pose_mae_dx": 0.021380068734288216,
      "pose_mae_dy": 0.014780819416046143,
      "pose_rmse_dtheta": 0.21645642817020416,
      "pose_rmse_dx": 0.05233428627252579,
      "pose_rmse_dy": 0.0427023246884346,
      "pose_rmse_mean": 0.10383101552724838,
      "rmse_dtheta": 0.02583770640194416,
      "rmse_dx": 0.006708027329295874,
      "rmse_dy": 0.004062209278345108,
      "rmse_mean": 0.01220264844596386,
      "rotation_flip": 0.001977587351575494,
      "sparse_tokens": 32137.0,
      "step": 1795,
      "turn_loss": 0.06739471107721329,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.08344173945363316,
      "grad_norm": 0.48810166120529175,
      "learning_rate": 9.517470159496492e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.009319738484919071,
      "mae_dx": 0.0018551723333075643,
      "mae_dy": 0.0014316394226625562,
      "pose_mae_dtheta": 0.06865891814231873,
      "pose_mae_dx": 0.019758792594075203,
      "pose_mae_dy": 0.01762658916413784,
      "pose_rmse_dtheta": 0.21526999771595,
      "pose_rmse_dx": 0.06032917648553848,
      "pose_rmse_dy": 0.042393315583467484,
      "pose_rmse_mean": 0.10599750280380249,
      "rmse_dtheta": 0.0248542632907629,
      "rmse_dx": 0.006176826544106007,
      "rmse_dy": 0.0035888184793293476,
      "rmse_mean": 0.011539969593286514,
      "rotation_flip": 0.003387533826753497,
      "sparse_tokens": 32057.0,
      "step": 1796,
      "turn_loss": 0.06520574539899826,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.08348819921947594,
      "grad_norm": 0.5430557727813721,
      "learning_rate": 9.51690329754341e-06,
      "loss": 0.1388,
      "mae_dtheta": 0.028644684702157974,
      "mae_dx": 0.010308117605745792,
      "mae_dy": 0.004185178317129612,
      "pose_mae_dtheta": 0.23355832695960999,
      "pose_mae_dx": 0.08115596324205399,
      "pose_mae_dy": 0.049232907593250275,
      "pose_rmse_dtheta": 0.4481082260608673,
      "pose_rmse_dx": 0.19832825660705566,
      "pose_rmse_dy": 0.11929536610841751,
      "pose_rmse_mean": 0.2552439570426941,
      "rmse_dtheta": 0.04689788073301315,
      "rmse_dx": 0.022345896810293198,
      "rmse_dy": 0.008632914163172245,
      "rmse_mean": 0.025958895683288574,
      "rotation_flip": 0.014035088010132313,
      "sparse_tokens": 21272.0,
      "step": 1797,
      "turn_loss": 0.22480446100234985,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.08353465898531871,
      "grad_norm": 0.6056971549987793,
      "learning_rate": 9.516336119720857e-06,
      "loss": 0.1151,
      "mae_dtheta": 0.03640099987387657,
      "mae_dx": 0.010932402685284615,
      "mae_dy": 0.006034188903868198,
      "pose_mae_dtheta": 0.32860055565834045,
      "pose_mae_dx": 0.09953147917985916,
      "pose_mae_dy": 0.09314005821943283,
      "pose_rmse_dtheta": 0.5859076380729675,
      "pose_rmse_dx": 0.2073742300271988,
      "pose_rmse_dy": 0.2048320323228836,
      "pose_rmse_mean": 0.33270463347435,
      "rmse_dtheta": 0.055350564420223236,
      "rmse_dx": 0.02273937687277794,
      "rmse_dy": 0.011633576825261116,
      "rmse_mean": 0.029907837510108948,
      "rotation_flip": 0.0036057692486792803,
      "sparse_tokens": 14134.0,
      "step": 1798,
      "turn_loss": 0.26657530665397644,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.08358111875116149,
      "grad_norm": 0.6997963786125183,
      "learning_rate": 9.515768626068496e-06,
      "loss": 0.172,
      "mae_dtheta": 0.023292947560548782,
      "mae_dx": 0.00879235565662384,
      "mae_dy": 0.005195622332394123,
      "pose_mae_dtheta": 0.157400980591774,
      "pose_mae_dx": 0.06593496352434158,
      "pose_mae_dy": 0.06606613099575043,
      "pose_rmse_dtheta": 0.23290613293647766,
      "pose_rmse_dx": 0.1348038911819458,
      "pose_rmse_dy": 0.13767091929912567,
      "pose_rmse_mean": 0.16846030950546265,
      "rmse_dtheta": 0.03549952059984207,
      "rmse_dx": 0.018217861652374268,
      "rmse_dy": 0.009060660377144814,
      "rmse_mean": 0.020926013588905334,
      "rotation_flip": 0.00522193219512701,
      "sparse_tokens": 5925.0,
      "step": 1799,
      "turn_loss": 0.21520070731639862,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 29433.0,
      "epoch": 0.08362757851700428,
      "grad_norm": 0.6760454773902893,
      "learning_rate": 9.51520081662601e-06,
      "loss": 0.1933,
      "mae_dtheta": 0.032062359154224396,
      "mae_dx": 0.012208998203277588,
      "mae_dy": 0.004262132104486227,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6760455965995789,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 137.18292236328125,
      "model/head/act_norm_mean": 99.11182177197803,
      "model/head/act_norm_min": 63.360313415527344,
      "model/head/act_over_embed": 68.11057182119802,
      "model/head/grad_frac": 0.11754687130451202,
      "model/head/grad_norm": 0.0794670432806015,
      "model/head/grad_zero_frac": 0.00019766030891332775,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6864053914835165,
      "model/head/update_ratio": 0.0013798205181956291,
      "model/head/weight_delta": 4.832512378692627,
      "model/head/weight_delta_rel": 0.08477658033370972,
      "model/head/weight_norm": 57.59230422973633,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4138689935207367,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4138689935207367,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4138689935207367,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2844146470500145,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07018052786588669,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04744523763656616,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.54296875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015432746149599552,
      "model/modality_embedder.encoders.pose/weight_delta": 1.5535874366760254,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05076054483652115,
      "model/modality_embedder.encoders.pose/weight_norm": 30.743223190307617,
      "model/modality_embedder/grad_frac": 0.07018052786588669,
      "model/modality_embedder/grad_norm": 0.04744523763656616,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.54296875,
      "model/modality_embedder/update_ratio": 0.0015432746149599552,
      "model/modality_embedder/weight_delta": 1.5535874366760254,
      "model/modality_embedder/weight_delta_rel": 0.05076054483652115,
      "model/modality_embedder/weight_norm": 30.743223190307617,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.9299087524414,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.317428974795046,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.074410438537598,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.336746130541107,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07350105792284012,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.049690064042806625,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018012424698099494,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.9246703386306763,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03369554504752159,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.586549758911133,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 77.64443969726562,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.219534929356357,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.596173286437988,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.95668178816465,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0774327889084816,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.052348095923662186,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017968087922781706,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.1452782154083252,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0396733321249485,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.133926391601562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.38241577148438,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.900343951683237,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.841424942016602,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.11174948428967,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08478903770446777,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.057321254163980484,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019065917003899813,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.2166862487792969,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04085404798388481,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.064777374267578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 80.53024291992188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.81323859672074,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.662471771240234,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.42630859316127,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0966876968741417,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06536529213190079,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002218259032815695,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.0394247770309448,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03552260622382164,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.46693229675293,
      "model/normalizer/grad_frac": 0.34903988242149353,
      "model/normalizer/grad_norm": 0.23596687614917755,
      "model/normalizer/grad_zero_frac": 0.0002292572462465614,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003027521073818207,
      "model/normalizer/weight_delta": 2.2267754077911377,
      "model/normalizer/weight_delta_rel": 0.028679577633738518,
      "model/normalizer/weight_norm": 77.94062042236328,
      "pose_mae_dtheta": 0.27040886878967285,
      "pose_mae_dx": 0.11097028851509094,
      "pose_mae_dy": 0.06369069218635559,
      "pose_rmse_dtheta": 0.48491644859313965,
      "pose_rmse_dx": 0.23736217617988586,
      "pose_rmse_dy": 0.17374280095100403,
      "pose_rmse_mean": 0.2986738085746765,
      "rmse_dtheta": 0.05086562782526016,
      "rmse_dx": 0.024815671145915985,
      "rmse_dy": 0.008881834335625172,
      "rmse_mean": 0.028187712654471397,
      "rotation_flip": 0.01715686358511448,
      "sparse_tokens": 22826.0,
      "step": 1800,
      "turn_loss": 0.2760166525840759,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "epoch": 0.08362757851700428,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.33069074153900146,
      "eval_objectnav_nopose_mae_dtheta": 0.04193595424294472,
      "eval_objectnav_nopose_mae_dx": 0.014258494600653648,
      "eval_objectnav_nopose_mae_dy": 0.005289650987833738,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.35127341747283936,
      "eval_objectnav_nopose_pose_mae_dx": 0.11651508510112762,
      "eval_objectnav_nopose_pose_mae_dy": 0.061872221529483795,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5808743834495544,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2502880394458771,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14649856090545654,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3258870244026184,
      "eval_objectnav_nopose_rmse_dtheta": 0.05992906540632248,
      "eval_objectnav_nopose_rmse_dx": 0.02721218392252922,
      "eval_objectnav_nopose_rmse_dy": 0.01091895904392004,
      "eval_objectnav_nopose_rmse_mean": 0.032686736434698105,
      "eval_objectnav_nopose_rotation_flip": 0.01168474555015564,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.33069074153900146,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 1800
    },
    {
      "epoch": 0.08362757851700428,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.29840797185897827,
      "eval_objectnav_pose_mae_dtheta": 0.03699806332588196,
      "eval_objectnav_pose_mae_dx": 0.012167238630354404,
      "eval_objectnav_pose_mae_dy": 0.004824027884751558,
      "eval_objectnav_pose_pose_mae_dtheta": 0.29093390703201294,
      "eval_objectnav_pose_pose_mae_dx": 0.09737810492515564,
      "eval_objectnav_pose_pose_mae_dy": 0.0525759682059288,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5057458281517029,
      "eval_objectnav_pose_pose_rmse_dx": 0.2224813848733902,
      "eval_objectnav_pose_pose_rmse_dy": 0.12979769706726074,
      "eval_objectnav_pose_pose_rmse_mean": 0.2860082983970642,
      "eval_objectnav_pose_rmse_dtheta": 0.055080655962228775,
      "eval_objectnav_pose_rmse_dx": 0.024783466011285782,
      "eval_objectnav_pose_rmse_dy": 0.010165270417928696,
      "eval_objectnav_pose_rmse_mean": 0.0300097968429327,
      "eval_objectnav_pose_rotation_flip": 0.012871073558926582,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.29840797185897827,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 1800
    },
    {
      "epoch": 0.08362757851700428,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10621262341737747,
      "eval_pointnav_mae_dtheta": 0.011925398372113705,
      "eval_pointnav_mae_dx": 0.0028521346393972635,
      "eval_pointnav_mae_dy": 0.002762915100902319,
      "eval_pointnav_pose_mae_dtheta": 0.08637536317110062,
      "eval_pointnav_pose_mae_dx": 0.032044652849435806,
      "eval_pointnav_pose_mae_dy": 0.03113093599677086,
      "eval_pointnav_pose_rmse_dtheta": 0.2310975342988968,
      "eval_pointnav_pose_rmse_dx": 0.08993347734212875,
      "eval_pointnav_pose_rmse_dy": 0.09054163098335266,
      "eval_pointnav_pose_rmse_mean": 0.13719087839126587,
      "eval_pointnav_rmse_dtheta": 0.027821609750390053,
      "eval_pointnav_rmse_dx": 0.008426409214735031,
      "eval_pointnav_rmse_dy": 0.007161780260503292,
      "eval_pointnav_rmse_mean": 0.01446993462741375,
      "eval_pointnav_rotation_flip": 0.0056133088655769825,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10621262341737747,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 1800
    },
    {
      "epoch": 0.08362757851700428,
      "eval_loss": 0.2451037789384524,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.33069074153900146,
      "eval_objectnav_nopose_mae_dtheta": 0.04193595424294472,
      "eval_objectnav_nopose_mae_dx": 0.014258494600653648,
      "eval_objectnav_nopose_mae_dy": 0.005289650987833738,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.35127341747283936,
      "eval_objectnav_nopose_pose_mae_dx": 0.11651508510112762,
      "eval_objectnav_nopose_pose_mae_dy": 0.061872221529483795,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5808743834495544,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2502880394458771,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14649856090545654,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3258870244026184,
      "eval_objectnav_nopose_rmse_dtheta": 0.05992906540632248,
      "eval_objectnav_nopose_rmse_dx": 0.02721218392252922,
      "eval_objectnav_nopose_rmse_dy": 0.01091895904392004,
      "eval_objectnav_nopose_rmse_mean": 0.032686736434698105,
      "eval_objectnav_nopose_rotation_flip": 0.01168474555015564,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.33069074153900146,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.29840797185897827,
      "eval_objectnav_pose_mae_dtheta": 0.03699806332588196,
      "eval_objectnav_pose_mae_dx": 0.012167238630354404,
      "eval_objectnav_pose_mae_dy": 0.004824027884751558,
      "eval_objectnav_pose_pose_mae_dtheta": 0.29093390703201294,
      "eval_objectnav_pose_pose_mae_dx": 0.09737810492515564,
      "eval_objectnav_pose_pose_mae_dy": 0.0525759682059288,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5057458281517029,
      "eval_objectnav_pose_pose_rmse_dx": 0.2224813848733902,
      "eval_objectnav_pose_pose_rmse_dy": 0.12979769706726074,
      "eval_objectnav_pose_pose_rmse_mean": 0.2860082983970642,
      "eval_objectnav_pose_rmse_dtheta": 0.055080655962228775,
      "eval_objectnav_pose_rmse_dx": 0.024783466011285782,
      "eval_objectnav_pose_rmse_dy": 0.010165270417928696,
      "eval_objectnav_pose_rmse_mean": 0.0300097968429327,
      "eval_objectnav_pose_rotation_flip": 0.012871073558926582,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.29840797185897827,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10621262341737747,
      "eval_pointnav_mae_dtheta": 0.011925398372113705,
      "eval_pointnav_mae_dx": 0.0028521346393972635,
      "eval_pointnav_mae_dy": 0.002762915100902319,
      "eval_pointnav_pose_mae_dtheta": 0.08637536317110062,
      "eval_pointnav_pose_mae_dx": 0.032044652849435806,
      "eval_pointnav_pose_mae_dy": 0.03113093599677086,
      "eval_pointnav_pose_rmse_dtheta": 0.2310975342988968,
      "eval_pointnav_pose_rmse_dx": 0.08993347734212875,
      "eval_pointnav_pose_rmse_dy": 0.09054163098335266,
      "eval_pointnav_pose_rmse_mean": 0.13719087839126587,
      "eval_pointnav_rmse_dtheta": 0.027821609750390053,
      "eval_pointnav_rmse_dx": 0.008426409214735031,
      "eval_pointnav_rmse_dy": 0.007161780260503292,
      "eval_pointnav_rmse_mean": 0.01446993462741375,
      "eval_pointnav_rotation_flip": 0.0056133088655769825,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10621262341737747,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 1800
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.08367403828284706,
      "grad_norm": 0.6193647980690002,
      "learning_rate": 9.514632691433108e-06,
      "loss": 0.1413,
      "mae_dtheta": 0.037934090942144394,
      "mae_dx": 0.019078321754932404,
      "mae_dy": 0.0036969210486859083,
      "pose_mae_dtheta": 0.30642378330230713,
      "pose_mae_dx": 0.16202448308467865,
      "pose_mae_dy": 0.05179358646273613,
      "pose_rmse_dtheta": 0.5244361162185669,
      "pose_rmse_dx": 0.3267190754413605,
      "pose_rmse_dy": 0.12007635831832886,
      "pose_rmse_mean": 0.3237438499927521,
      "rmse_dtheta": 0.05499584600329399,
      "rmse_dx": 0.03344525396823883,
      "rmse_dy": 0.007258323021233082,
      "rmse_mean": 0.03189980983734131,
      "rotation_flip": 0.017595307901501656,
      "sparse_tokens": 5681.0,
      "step": 1801,
      "turn_loss": 0.30246609449386597,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.08372049804868983,
      "grad_norm": 0.614194393157959,
      "learning_rate": 9.514064250529517e-06,
      "loss": 0.1325,
      "mae_dtheta": 0.038066666573286057,
      "mae_dx": 0.022098619490861893,
      "mae_dy": 0.0033734594471752644,
      "pose_mae_dtheta": 0.240904301404953,
      "pose_mae_dx": 0.1971195936203003,
      "pose_mae_dy": 0.0584406740963459,
      "pose_rmse_dtheta": 0.5162007212638855,
      "pose_rmse_dx": 0.3855207562446594,
      "pose_rmse_dy": 0.1297835111618042,
      "pose_rmse_mean": 0.3438349962234497,
      "rmse_dtheta": 0.05710974335670471,
      "rmse_dx": 0.03788201883435249,
      "rmse_dy": 0.006810950580984354,
      "rmse_mean": 0.03393423557281494,
      "rotation_flip": 0.028901733458042145,
      "sparse_tokens": 3494.0,
      "step": 1802,
      "turn_loss": 0.2731216847896576,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 34388.0,
      "epoch": 0.08376695781453261,
      "grad_norm": 0.581249475479126,
      "learning_rate": 9.513495493954992e-06,
      "loss": 0.2129,
      "mae_dtheta": 0.035526685416698456,
      "mae_dx": 0.012970101088285446,
      "mae_dy": 0.005991028156131506,
      "pose_mae_dtheta": 0.2790779173374176,
      "pose_mae_dx": 0.09394660592079163,
      "pose_mae_dy": 0.07011669129133224,
      "pose_rmse_dtheta": 0.4782586991786957,
      "pose_rmse_dx": 0.209518700838089,
      "pose_rmse_dy": 0.16528961062431335,
      "pose_rmse_mean": 0.28435570001602173,
      "rmse_dtheta": 0.052363451570272446,
      "rmse_dx": 0.025452565401792526,
      "rmse_dy": 0.011067886836826801,
      "rmse_mean": 0.02962796948850155,
      "rotation_flip": 0.011706716381013393,
      "sparse_tokens": 27595.0,
      "step": 1803,
      "turn_loss": 0.31965309381484985,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 2302.0,
      "epoch": 0.0838134175803754,
      "grad_norm": 0.5257826447486877,
      "learning_rate": 9.512926421749305e-06,
      "loss": 0.1323,
      "mae_dtheta": 0.05229314789175987,
      "mae_dx": 0.016737906262278557,
      "mae_dy": 0.010726519860327244,
      "pose_mae_dtheta": 0.43197599053382874,
      "pose_mae_dx": 0.11569999903440475,
      "pose_mae_dy": 0.15480384230613708,
      "pose_rmse_dtheta": 0.5995430946350098,
      "pose_rmse_dx": 0.1853334754705429,
      "pose_rmse_dy": 0.28923889994621277,
      "pose_rmse_mean": 0.3580385148525238,
      "rmse_dtheta": 0.06497730314731598,
      "rmse_dx": 0.02715953439474106,
      "rmse_dy": 0.021269407123327255,
      "rmse_mean": 0.0378020815551281,
      "rotation_flip": 0.007751937955617905,
      "sparse_tokens": 1869.0,
      "step": 1804,
      "turn_loss": 0.3261208236217499,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08385987734621818,
      "grad_norm": 0.5661117434501648,
      "learning_rate": 9.512357033952248e-06,
      "loss": 0.1581,
      "mae_dtheta": 0.005109354853630066,
      "mae_dx": 0.002055706921964884,
      "mae_dy": 0.00038178416434675455,
      "pose_mae_dtheta": 0.0378192700445652,
      "pose_mae_dx": 0.018341388553380966,
      "pose_mae_dy": 0.006010831333696842,
      "pose_rmse_dtheta": 0.1830519586801529,
      "pose_rmse_dx": 0.06233157962560654,
      "pose_rmse_dy": 0.022762103006243706,
      "pose_rmse_mean": 0.0893818736076355,
      "rmse_dtheta": 0.02184309996664524,
      "rmse_dx": 0.007165880873799324,
      "rmse_dy": 0.001245932187885046,
      "rmse_mean": 0.010084971785545349,
      "rotation_flip": 0.002406738931313157,
      "sparse_tokens": 32089.0,
      "step": 1805,
      "turn_loss": 0.04000286012887955,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.08390633711206096,
      "grad_norm": 0.5185210108757019,
      "learning_rate": 9.511787330603645e-06,
      "loss": 0.1298,
      "mae_dtheta": 0.00925788190215826,
      "mae_dx": 0.0020578543189913034,
      "mae_dy": 0.000699387863278389,
      "pose_mae_dtheta": 0.06878255307674408,
      "pose_mae_dx": 0.018858369439840317,
      "pose_mae_dy": 0.010205993428826332,
      "pose_rmse_dtheta": 0.2497948259115219,
      "pose_rmse_dx": 0.05496412515640259,
      "pose_rmse_dy": 0.03795711323618889,
      "pose_rmse_mean": 0.1142386943101883,
      "rmse_dtheta": 0.029735568910837173,
      "rmse_dx": 0.00621151365339756,
      "rmse_dy": 0.002076938282698393,
      "rmse_mean": 0.012674674391746521,
      "rotation_flip": 0.0037878789007663727,
      "sparse_tokens": 32201.0,
      "step": 1806,
      "turn_loss": 0.06155598163604736,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.08395279687790373,
      "grad_norm": 0.5890132188796997,
      "learning_rate": 9.51121731174333e-06,
      "loss": 0.2071,
      "mae_dtheta": 0.011862596496939659,
      "mae_dx": 0.004014905542135239,
      "mae_dy": 0.0027284177485853434,
      "pose_mae_dtheta": 0.08820054680109024,
      "pose_mae_dx": 0.03970852866768837,
      "pose_mae_dy": 0.03460805118083954,
      "pose_rmse_dtheta": 0.2144297957420349,
      "pose_rmse_dx": 0.12844137847423553,
      "pose_rmse_dy": 0.09997104853391647,
      "pose_rmse_mean": 0.14761409163475037,
      "rmse_dtheta": 0.026443177834153175,
      "rmse_dx": 0.012896465137600899,
      "rmse_dy": 0.006310577504336834,
      "rmse_mean": 0.015216740779578686,
      "rotation_flip": 0.00916963815689087,
      "sparse_tokens": 32073.0,
      "step": 1807,
      "turn_loss": 0.13665997982025146,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.08399925664374651,
      "grad_norm": 0.6593230366706848,
      "learning_rate": 9.510646977411168e-06,
      "loss": 0.1507,
      "mae_dtheta": 0.010762273333966732,
      "mae_dx": 0.0022718491964042187,
      "mae_dy": 0.0026566805317997932,
      "pose_mae_dtheta": 0.06872936338186264,
      "pose_mae_dx": 0.02465287409722805,
      "pose_mae_dy": 0.03245172277092934,
      "pose_rmse_dtheta": 0.13096676766872406,
      "pose_rmse_dx": 0.05768251791596413,
      "pose_rmse_dy": 0.07615736871957779,
      "pose_rmse_mean": 0.08826889097690582,
      "rmse_dtheta": 0.021580688655376434,
      "rmse_dx": 0.006718234159052372,
      "rmse_dy": 0.006358503829687834,
      "rmse_mean": 0.011552475392818451,
      "rotation_flip": 0.005998588632792234,
      "sparse_tokens": 32169.0,
      "step": 1808,
      "turn_loss": 0.0979321151971817,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.0840457164095893,
      "grad_norm": 0.6597926020622253,
      "learning_rate": 9.510076327647043e-06,
      "loss": 0.1937,
      "mae_dtheta": 0.027044476941227913,
      "mae_dx": 0.009716846980154514,
      "mae_dy": 0.003884238889440894,
      "pose_mae_dtheta": 0.16157184541225433,
      "pose_mae_dx": 0.090760238468647,
      "pose_mae_dy": 0.041654072701931,
      "pose_rmse_dtheta": 0.3269534409046173,
      "pose_rmse_dx": 0.24739670753479004,
      "pose_rmse_dy": 0.09219519793987274,
      "pose_rmse_mean": 0.2221817821264267,
      "rmse_dtheta": 0.04451124742627144,
      "rmse_dx": 0.02385743148624897,
      "rmse_dy": 0.009145866148173809,
      "rmse_mean": 0.025838181376457214,
      "rotation_flip": 0.012315270490944386,
      "sparse_tokens": 6887.0,
      "step": 1809,
      "turn_loss": 0.2286255657672882,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.08409217617543208,
      "grad_norm": 0.41193798184394836,
      "learning_rate": 9.509505362490858e-06,
      "loss": 0.1283,
      "mae_dtheta": 0.02908572368323803,
      "mae_dx": 0.01297094114124775,
      "mae_dy": 0.005703888367861509,
      "pose_mae_dtheta": 0.2365589588880539,
      "pose_mae_dx": 0.09800044447183609,
      "pose_mae_dy": 0.0866871103644371,
      "pose_rmse_dtheta": 0.39311036467552185,
      "pose_rmse_dx": 0.22564822435379028,
      "pose_rmse_dy": 0.20073504745960236,
      "pose_rmse_mean": 0.2731645405292511,
      "rmse_dtheta": 0.04263533279299736,
      "rmse_dx": 0.0263111162930727,
      "rmse_dy": 0.009776540100574493,
      "rmse_mean": 0.0262409970164299,
      "rotation_flip": 0.011428571306169033,
      "sparse_tokens": 9137.0,
      "step": 1810,
      "turn_loss": 0.25708436965942383,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08413863594127485,
      "grad_norm": 0.5782761573791504,
      "learning_rate": 9.508934081982545e-06,
      "loss": 0.183,
      "mae_dtheta": 0.013907809741795063,
      "mae_dx": 0.0025966602843254805,
      "mae_dy": 0.0038662825245410204,
      "pose_mae_dtheta": 0.09775140881538391,
      "pose_mae_dx": 0.0320960208773613,
      "pose_mae_dy": 0.045733269304037094,
      "pose_rmse_dtheta": 0.1993330717086792,
      "pose_rmse_dx": 0.08089235424995422,
      "pose_rmse_dy": 0.09576748311519623,
      "pose_rmse_mean": 0.12533096969127655,
      "rmse_dtheta": 0.0268191359937191,
      "rmse_dx": 0.007816492579877377,
      "rmse_dy": 0.008476497605443,
      "rmse_mean": 0.014370709657669067,
      "rotation_flip": 0.008985024876892567,
      "sparse_tokens": 32089.0,
      "step": 1811,
      "turn_loss": 0.1232045367360115,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.08418509570711763,
      "grad_norm": 0.40836092829704285,
      "learning_rate": 9.50836248616205e-06,
      "loss": 0.1258,
      "mae_dtheta": 0.012513814494013786,
      "mae_dx": 0.003255089744925499,
      "mae_dy": 0.0032191979698836803,
      "pose_mae_dtheta": 0.08680905401706696,
      "pose_mae_dx": 0.03751111775636673,
      "pose_mae_dy": 0.03293580189347267,
      "pose_rmse_dtheta": 0.21577316522598267,
      "pose_rmse_dx": 0.11550050228834152,
      "pose_rmse_dy": 0.10619574785232544,
      "pose_rmse_mean": 0.1458231508731842,
      "rmse_dtheta": 0.02693137712776661,
      "rmse_dx": 0.010316298343241215,
      "rmse_dy": 0.008700600825250149,
      "rmse_mean": 0.01531609334051609,
      "rotation_flip": 0.0035407182294875383,
      "sparse_tokens": 32073.0,
      "step": 1812,
      "turn_loss": 0.10529183596372604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.08423155547296042,
      "grad_norm": 0.5603656768798828,
      "learning_rate": 9.507790575069347e-06,
      "loss": 0.0922,
      "mae_dtheta": 0.014148064889013767,
      "mae_dx": 0.0026586782187223434,
      "mae_dy": 0.003719897475093603,
      "pose_mae_dtheta": 0.10060805082321167,
      "pose_mae_dx": 0.0406346395611763,
      "pose_mae_dy": 0.04325011372566223,
      "pose_rmse_dtheta": 0.21462059020996094,
      "pose_rmse_dx": 0.1085125207901001,
      "pose_rmse_dy": 0.09298373758792877,
      "pose_rmse_mean": 0.13870561122894287,
      "rmse_dtheta": 0.028270753100514412,
      "rmse_dx": 0.008098785765469074,
      "rmse_dy": 0.008272740058600903,
      "rmse_mean": 0.014880760572850704,
      "rotation_flip": 0.0046968404203653336,
      "sparse_tokens": 32057.0,
      "step": 1813,
      "turn_loss": 0.10668609291315079,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.0842780152388032,
      "grad_norm": 0.5129084587097168,
      "learning_rate": 9.507218348744429e-06,
      "loss": 0.1443,
      "mae_dtheta": 0.033022474497556686,
      "mae_dx": 0.013038779608905315,
      "mae_dy": 0.004789755214005709,
      "pose_mae_dtheta": 0.28542640805244446,
      "pose_mae_dx": 0.11945103853940964,
      "pose_mae_dy": 0.0512443408370018,
      "pose_rmse_dtheta": 0.48117563128471375,
      "pose_rmse_dx": 0.2576764225959778,
      "pose_rmse_dy": 0.09664527326822281,
      "pose_rmse_mean": 0.27849912643432617,
      "rmse_dtheta": 0.051869072020053864,
      "rmse_dx": 0.0256985854357481,
      "rmse_dy": 0.008513469249010086,
      "rmse_mean": 0.028693711385130882,
      "rotation_flip": 0.012987012974917889,
      "sparse_tokens": 7119.0,
      "step": 1814,
      "turn_loss": 0.20269177854061127,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.08432447500464597,
      "grad_norm": 0.536584198474884,
      "learning_rate": 9.506645807227311e-06,
      "loss": 0.1559,
      "mae_dtheta": 0.03421997278928757,
      "mae_dx": 0.009321351535618305,
      "mae_dy": 0.0034102860372513533,
      "pose_mae_dtheta": 0.2838819921016693,
      "pose_mae_dx": 0.06933921575546265,
      "pose_mae_dy": 0.037176039069890976,
      "pose_rmse_dtheta": 0.485418438911438,
      "pose_rmse_dx": 0.19957752525806427,
      "pose_rmse_dy": 0.09393423050642014,
      "pose_rmse_mean": 0.25964340567588806,
      "rmse_dtheta": 0.051023293286561966,
      "rmse_dx": 0.021811893209815025,
      "rmse_dy": 0.009745593182742596,
      "rmse_mean": 0.02752692624926567,
      "rotation_flip": 0.0061349691823124886,
      "sparse_tokens": 5818.0,
      "step": 1815,
      "turn_loss": 0.2605234980583191,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.08437093477048875,
      "grad_norm": 0.42470017075538635,
      "learning_rate": 9.506072950558036e-06,
      "loss": 0.0686,
      "mae_dtheta": 0.010847344063222408,
      "mae_dx": 0.0022860278841108084,
      "mae_dy": 0.0009615112794563174,
      "pose_mae_dtheta": 0.08146219700574875,
      "pose_mae_dx": 0.020150883123278618,
      "pose_mae_dy": 0.012394343502819538,
      "pose_rmse_dtheta": 0.25950169563293457,
      "pose_rmse_dx": 0.04590766876935959,
      "pose_rmse_dy": 0.03987783193588257,
      "pose_rmse_mean": 0.11509573459625244,
      "rmse_dtheta": 0.030358199030160904,
      "rmse_dx": 0.00648850854486227,
      "rmse_dy": 0.0025854012928903103,
      "rmse_mean": 0.013144036754965782,
      "rotation_flip": 0.003892733482643962,
      "sparse_tokens": 32249.0,
      "step": 1816,
      "turn_loss": 0.07070359587669373,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.08441739453633154,
      "grad_norm": 0.9924291372299194,
      "learning_rate": 9.505499778776659e-06,
      "loss": 0.2006,
      "mae_dtheta": 0.044777221977710724,
      "mae_dx": 0.010436110198497772,
      "mae_dy": 0.006249113939702511,
      "pose_mae_dtheta": 0.3796733021736145,
      "pose_mae_dx": 0.11732564866542816,
      "pose_mae_dy": 0.0783093199133873,
      "pose_rmse_dtheta": 0.6135990619659424,
      "pose_rmse_dx": 0.2378813624382019,
      "pose_rmse_dy": 0.20275767147541046,
      "pose_rmse_mean": 0.35141271352767944,
      "rmse_dtheta": 0.06522270292043686,
      "rmse_dx": 0.02042955718934536,
      "rmse_dy": 0.01531456969678402,
      "rmse_mean": 0.03365561366081238,
      "rotation_flip": 0.0035211266949772835,
      "sparse_tokens": 4563.0,
      "step": 1817,
      "turn_loss": 0.2994680404663086,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.08446385430217432,
      "grad_norm": 0.4967580735683441,
      "learning_rate": 9.504926291923265e-06,
      "loss": 0.1487,
      "mae_dtheta": 0.032378390431404114,
      "mae_dx": 0.010194513946771622,
      "mae_dy": 0.005477307830005884,
      "pose_mae_dtheta": 0.24375244975090027,
      "pose_mae_dx": 0.07746762037277222,
      "pose_mae_dy": 0.06072421744465828,
      "pose_rmse_dtheta": 0.44282448291778564,
      "pose_rmse_dx": 0.175911545753479,
      "pose_rmse_dy": 0.14623570442199707,
      "pose_rmse_mean": 0.2549905776977539,
      "rmse_dtheta": 0.049871545284986496,
      "rmse_dx": 0.021139422431588173,
      "rmse_dy": 0.011912032030522823,
      "rmse_mean": 0.02764100208878517,
      "rotation_flip": 0.012976479716598988,
      "sparse_tokens": 21567.0,
      "step": 1818,
      "turn_loss": 0.2706463634967804,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 36014.0,
      "epoch": 0.0845103140680171,
      "grad_norm": 1.2477807998657227,
      "learning_rate": 9.504352490037957e-06,
      "loss": 0.2568,
      "mae_dtheta": 0.03305177018046379,
      "mae_dx": 0.011943879537284374,
      "mae_dy": 0.004752774257212877,
      "pose_mae_dtheta": 0.25003623962402344,
      "pose_mae_dx": 0.10072704404592514,
      "pose_mae_dy": 0.05735496059060097,
      "pose_rmse_dtheta": 0.43357500433921814,
      "pose_rmse_dx": 0.2197044938802719,
      "pose_rmse_dy": 0.15472440421581268,
      "pose_rmse_mean": 0.2693346440792084,
      "rmse_dtheta": 0.04994284734129906,
      "rmse_dx": 0.024105262011289597,
      "rmse_dy": 0.010143325664103031,
      "rmse_mean": 0.028063811361789703,
      "rotation_flip": 0.012445550411939621,
      "sparse_tokens": 27414.0,
      "step": 1819,
      "turn_loss": 0.2816386818885803,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.08455677383385987,
      "grad_norm": 0.6356178522109985,
      "learning_rate": 9.503778373160863e-06,
      "loss": 0.1632,
      "mae_dtheta": 0.029325831681489944,
      "mae_dx": 0.010494598187506199,
      "mae_dy": 0.003925899043679237,
      "pose_mae_dtheta": 0.2426818460226059,
      "pose_mae_dx": 0.08596909791231155,
      "pose_mae_dy": 0.05380849912762642,
      "pose_rmse_dtheta": 0.43953555822372437,
      "pose_rmse_dx": 0.20027171075344086,
      "pose_rmse_dy": 0.1263132095336914,
      "pose_rmse_mean": 0.2553735077381134,
      "rmse_dtheta": 0.048808906227350235,
      "rmse_dx": 0.022228263318538666,
      "rmse_dy": 0.008840855211019516,
      "rmse_mean": 0.026626011356711388,
      "rotation_flip": 0.0117647061124444,
      "sparse_tokens": 10885.0,
      "step": 1820,
      "turn_loss": 0.23625342547893524,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08460323359970266,
      "grad_norm": 0.6287823915481567,
      "learning_rate": 9.503203941332128e-06,
      "loss": 0.1659,
      "mae_dtheta": 0.013304506428539753,
      "mae_dx": 0.002473376924172044,
      "mae_dy": 0.002652146853506565,
      "pose_mae_dtheta": 0.09299913048744202,
      "pose_mae_dx": 0.028294548392295837,
      "pose_mae_dy": 0.030244313180446625,
      "pose_rmse_dtheta": 0.25943684577941895,
      "pose_rmse_dx": 0.07999090105295181,
      "pose_rmse_dy": 0.07645586133003235,
      "pose_rmse_mean": 0.13862787187099457,
      "rmse_dtheta": 0.030544526875019073,
      "rmse_dx": 0.008432707749307156,
      "rmse_dy": 0.007666202262043953,
      "rmse_mean": 0.01554781198501587,
      "rotation_flip": 0.006595218554139137,
      "sparse_tokens": 32089.0,
      "step": 1821,
      "turn_loss": 0.10725738108158112,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.08464969336554544,
      "grad_norm": 0.36653581261634827,
      "learning_rate": 9.502629194591925e-06,
      "loss": 0.1388,
      "mae_dtheta": 0.036092981696128845,
      "mae_dx": 0.011993522755801678,
      "mae_dy": 0.009869708679616451,
      "pose_mae_dtheta": 0.29520654678344727,
      "pose_mae_dx": 0.09561286866664886,
      "pose_mae_dy": 0.08644741028547287,
      "pose_rmse_dtheta": 0.5153898000717163,
      "pose_rmse_dx": 0.18646126985549927,
      "pose_rmse_dy": 0.1755666434764862,
      "pose_rmse_mean": 0.29247257113456726,
      "rmse_dtheta": 0.05351997911930084,
      "rmse_dx": 0.02253536507487297,
      "rmse_dy": 0.02145225554704666,
      "rmse_mean": 0.03250253573060036,
      "rotation_flip": 0.011695906519889832,
      "sparse_tokens": 7310.0,
      "step": 1822,
      "turn_loss": 0.3705216944217682,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08469615313138822,
      "grad_norm": 0.42724543809890747,
      "learning_rate": 9.502054132980447e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.00981918815523386,
      "mae_dx": 0.0018036147812381387,
      "mae_dy": 0.0019886819645762444,
      "pose_mae_dtheta": 0.06360412389039993,
      "pose_mae_dx": 0.02003132365643978,
      "pose_mae_dy": 0.026435082778334618,
      "pose_rmse_dtheta": 0.12608866393566132,
      "pose_rmse_dx": 0.050571661442518234,
      "pose_rmse_dy": 0.05876237899065018,
      "pose_rmse_mean": 0.07847423851490021,
      "rmse_dtheta": 0.01906728744506836,
      "rmse_dx": 0.005804560147225857,
      "rmse_dy": 0.004099697805941105,
      "rmse_mean": 0.009657181799411774,
      "rotation_flip": 0.005072463769465685,
      "sparse_tokens": 32121.0,
      "step": 1823,
      "turn_loss": 0.08220129460096359,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.08474261289723099,
      "grad_norm": 0.4758393466472626,
      "learning_rate": 9.501478756537906e-06,
      "loss": 0.1541,
      "mae_dtheta": 0.03533394634723663,
      "mae_dx": 0.01709388568997383,
      "mae_dy": 0.0110286520794034,
      "pose_mae_dtheta": 0.23898771405220032,
      "pose_mae_dx": 0.11735880374908447,
      "pose_mae_dy": 0.10015226155519485,
      "pose_rmse_dtheta": 0.3681042194366455,
      "pose_rmse_dx": 0.2358095943927765,
      "pose_rmse_dy": 0.19611935317516327,
      "pose_rmse_mean": 0.26667773723602295,
      "rmse_dtheta": 0.049273811280727386,
      "rmse_dx": 0.030828602612018585,
      "rmse_dy": 0.015020566061139107,
      "rmse_mean": 0.03170765936374664,
      "rotation_flip": 0.029411764815449715,
      "sparse_tokens": 2615.0,
      "step": 1824,
      "turn_loss": 0.3248719871044159,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.08478907266307378,
      "grad_norm": 0.4330427646636963,
      "learning_rate": 9.50090306530454e-06,
      "loss": 0.1359,
      "mae_dtheta": 0.04964829236268997,
      "mae_dx": 0.020616132766008377,
      "mae_dy": 0.003287132829427719,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4330427348613739,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 112.38723754882812,
      "model/head/act_norm_mean": 87.55979965672348,
      "model/head/act_norm_min": 70.5993881225586,
      "model/head/act_over_embed": 60.1719140718601,
      "model/head/grad_frac": 0.12727831304073334,
      "model/head/grad_norm": 0.05511695146560669,
      "model/head/grad_zero_frac": 0.00018877669936046004,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6918501420454546,
      "model/head/update_ratio": 0.0009568640380166471,
      "model/head/weight_delta": 4.873822212219238,
      "model/head/weight_delta_rel": 0.0855012759566307,
      "model/head/weight_norm": 57.601654052734375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4140170216560364,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4140170216560364,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4140170216560364,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2845163733704537,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08517374098300934,
      "model/modality_embedder.encoders.pose/grad_norm": 0.036883868277072906,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001199639867991209,
      "model/modality_embedder.encoders.pose/weight_delta": 1.5732086896896362,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05140163004398346,
      "model/modality_embedder.encoders.pose/weight_norm": 30.745784759521484,
      "model/modality_embedder/grad_frac": 0.08517374098300934,
      "model/modality_embedder/grad_norm": 0.036883868277072906,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.001199639867991209,
      "model/modality_embedder/weight_delta": 1.5732086896896362,
      "model/modality_embedder/weight_delta_rel": 0.05140163004398346,
      "model/modality_embedder/weight_norm": 30.745784759521484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 51.28858184814453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 21.216179653679653,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.114689826965332,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 14.579957287012027,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10705021768808365,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04635731875896454,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016803088365122676,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.9355480074882507,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03409193456172943,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.58856964111328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 52.97439193725586,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.035979211760463,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.81472110748291,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.143331218409545,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09596122801303864,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.041555311530828476,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014261748874559999,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.1589436531066895,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.040146712213754654,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.137598037719727,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 55.04867935180664,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 23.579900568181817,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.11227035522461,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.20432842896177,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0985904261469841,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04269386827945709,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00141990149859339,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.2313789129257202,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04134739935398102,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.06818962097168,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 56.279781341552734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 25.586441047378546,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.123656272888184,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 17.5832418317937,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10004528611898422,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04332388564944267,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014701004838570952,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.05306077003479,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03598862141370773,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.470016479492188,
      "model/normalizer/grad_frac": 0.35731664299964905,
      "model/normalizer/grad_norm": 0.15473337471485138,
      "model/normalizer/grad_zero_frac": 0.00021389465837273747,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0019851690158247948,
      "model/normalizer/weight_delta": 2.2539474964141846,
      "model/normalizer/weight_delta_rel": 0.029029538854956627,
      "model/normalizer/weight_norm": 77.94468688964844,
      "pose_mae_dtheta": 0.4881553649902344,
      "pose_mae_dx": 0.16788266599178314,
      "pose_mae_dy": 0.051388345658779144,
      "pose_rmse_dtheta": 0.6981594562530518,
      "pose_rmse_dx": 0.31334832310676575,
      "pose_rmse_dy": 0.12255905568599701,
      "pose_rmse_mean": 0.37802228331565857,
      "rmse_dtheta": 0.06652641296386719,
      "rmse_dx": 0.032475367188453674,
      "rmse_dy": 0.006544999312609434,
      "rmse_mean": 0.03518225997686386,
      "rotation_flip": 0.014814814552664757,
      "sparse_tokens": 8328.0,
      "step": 1825,
      "turn_loss": 0.4012911021709442,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.08483553242891656,
      "grad_norm": 0.7413516640663147,
      "learning_rate": 9.500327059320606e-06,
      "loss": 0.123,
      "mae_dtheta": 0.011704489588737488,
      "mae_dx": 0.0035202486906200647,
      "mae_dy": 0.0022751956712454557,
      "pose_mae_dtheta": 0.08545257151126862,
      "pose_mae_dx": 0.03447642922401428,
      "pose_mae_dy": 0.027665000408887863,
      "pose_rmse_dtheta": 0.20116662979125977,
      "pose_rmse_dx": 0.10711760073900223,
      "pose_rmse_dy": 0.06480967253446579,
      "pose_rmse_mean": 0.12436463683843613,
      "rmse_dtheta": 0.02490563876926899,
      "rmse_dx": 0.01116316020488739,
      "rmse_dy": 0.006344106048345566,
      "rmse_mean": 0.014137635007500648,
      "rotation_flip": 0.006109979469329119,
      "sparse_tokens": 32105.0,
      "step": 1826,
      "turn_loss": 0.09243655204772949,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32114.0,
      "epoch": 0.08488199219475934,
      "grad_norm": 0.6822682619094849,
      "learning_rate": 9.499750738626386e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.027964724227786064,
      "mae_dx": 0.007724500726908445,
      "mae_dy": 0.005202072206884623,
      "pose_mae_dtheta": 0.2157134860754013,
      "pose_mae_dx": 0.07121143490076065,
      "pose_mae_dy": 0.07616844773292542,
      "pose_rmse_dtheta": 0.41375577449798584,
      "pose_rmse_dx": 0.17965218424797058,
      "pose_rmse_dy": 0.17195849120616913,
      "pose_rmse_mean": 0.25512218475341797,
      "rmse_dtheta": 0.045855239033699036,
      "rmse_dx": 0.019065311178565025,
      "rmse_dy": 0.00992226880043745,
      "rmse_mean": 0.024947606027126312,
      "rotation_flip": 0.013545816764235497,
      "sparse_tokens": 26142.0,
      "step": 1827,
      "turn_loss": 0.2214326113462448,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 44138.0,
      "epoch": 0.08492845196060211,
      "grad_norm": 0.7880256772041321,
      "learning_rate": 9.499174103262182e-06,
      "loss": 0.2664,
      "mae_dtheta": 0.03810034692287445,
      "mae_dx": 0.013115921057760715,
      "mae_dy": 0.004061262588948011,
      "pose_mae_dtheta": 0.28702670335769653,
      "pose_mae_dx": 0.09701273590326309,
      "pose_mae_dy": 0.04553773254156113,
      "pose_rmse_dtheta": 0.48422566056251526,
      "pose_rmse_dx": 0.22149480879306793,
      "pose_rmse_dy": 0.119685597717762,
      "pose_rmse_mean": 0.2751353681087494,
      "rmse_dtheta": 0.05533009395003319,
      "rmse_dx": 0.025658365339040756,
      "rmse_dy": 0.008119048550724983,
      "rmse_mean": 0.029702503234148026,
      "rotation_flip": 0.013346514664590359,
      "sparse_tokens": 30338.0,
      "step": 1828,
      "turn_loss": 0.2734876871109009,
      "turns": 136.0,
      "turns_per_sample": 136.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0849749117264449,
      "grad_norm": 0.5992503762245178,
      "learning_rate": 9.498597153268317e-06,
      "loss": 0.1677,
      "mae_dtheta": 0.010808005928993225,
      "mae_dx": 0.003432902041822672,
      "mae_dy": 0.0028486414812505245,
      "pose_mae_dtheta": 0.07826296240091324,
      "pose_mae_dx": 0.032203078269958496,
      "pose_mae_dy": 0.03361239284276962,
      "pose_rmse_dtheta": 0.1977020651102066,
      "pose_rmse_dx": 0.0954093337059021,
      "pose_rmse_dy": 0.08972131460905075,
      "pose_rmse_mean": 0.12761090695858002,
      "rmse_dtheta": 0.02506893500685692,
      "rmse_dx": 0.01109275035560131,
      "rmse_dy": 0.007344513200223446,
      "rmse_mean": 0.014502066187560558,
      "rotation_flip": 0.0040766410529613495,
      "sparse_tokens": 32121.0,
      "step": 1829,
      "turn_loss": 0.10109970718622208,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.08502137149228768,
      "grad_norm": 0.6211910843849182,
      "learning_rate": 9.49801988868514e-06,
      "loss": 0.1656,
      "mae_dtheta": 0.029407231137156487,
      "mae_dx": 0.010887842625379562,
      "mae_dy": 0.004657956305891275,
      "pose_mae_dtheta": 0.2284754067659378,
      "pose_mae_dx": 0.07960330694913864,
      "pose_mae_dy": 0.07264939695596695,
      "pose_rmse_dtheta": 0.39645886421203613,
      "pose_rmse_dx": 0.18141980469226837,
      "pose_rmse_dy": 0.16409336030483246,
      "pose_rmse_mean": 0.24732401967048645,
      "rmse_dtheta": 0.04646411910653114,
      "rmse_dx": 0.024157138541340828,
      "rmse_dy": 0.00831341091543436,
      "rmse_mean": 0.026311557739973068,
      "rotation_flip": 0.010958904400467873,
      "sparse_tokens": 13800.0,
      "step": 1830,
      "turn_loss": 0.23403911292552948,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 15267.0,
      "epoch": 0.08506783125813046,
      "grad_norm": 0.5886390209197998,
      "learning_rate": 9.497442309553017e-06,
      "loss": 0.1992,
      "mae_dtheta": 0.04195058345794678,
      "mae_dx": 0.016521483659744263,
      "mae_dy": 0.007039010990411043,
      "pose_mae_dtheta": 0.30775514245033264,
      "pose_mae_dx": 0.14681826531887054,
      "pose_mae_dy": 0.062279265373945236,
      "pose_rmse_dtheta": 0.4937771260738373,
      "pose_rmse_dx": 0.2696616053581238,
      "pose_rmse_dy": 0.12072377651929855,
      "pose_rmse_mean": 0.2947208285331726,
      "rmse_dtheta": 0.05743787810206413,
      "rmse_dx": 0.027881642803549767,
      "rmse_dy": 0.013250747695565224,
      "rmse_mean": 0.03285675495862961,
      "rotation_flip": 0.018543045967817307,
      "sparse_tokens": 12153.0,
      "step": 1831,
      "turn_loss": 0.39556559920310974,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.08511429102397323,
      "grad_norm": 0.6731691956520081,
      "learning_rate": 9.496864415912339e-06,
      "loss": 0.1954,
      "mae_dtheta": 0.02957022190093994,
      "mae_dx": 0.010534567758440971,
      "mae_dy": 0.004122808109968901,
      "pose_mae_dtheta": 0.20553867518901825,
      "pose_mae_dx": 0.09253569692373276,
      "pose_mae_dy": 0.048337195068597794,
      "pose_rmse_dtheta": 0.37872880697250366,
      "pose_rmse_dx": 0.19927255809307098,
      "pose_rmse_dy": 0.12349913269281387,
      "pose_rmse_mean": 0.23383352160453796,
      "rmse_dtheta": 0.04653897508978844,
      "rmse_dx": 0.022007955238223076,
      "rmse_dy": 0.008606810122728348,
      "rmse_mean": 0.02571791410446167,
      "rotation_flip": 0.02711864374577999,
      "sparse_tokens": 9193.0,
      "step": 1832,
      "turn_loss": 0.28257685899734497,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.08516075078981603,
      "grad_norm": 0.5727611184120178,
      "learning_rate": 9.49628620780352e-06,
      "loss": 0.1663,
      "mae_dtheta": 0.013382717967033386,
      "mae_dx": 0.0029381883796304464,
      "mae_dy": 0.0038688851054757833,
      "pose_mae_dtheta": 0.10290709137916565,
      "pose_mae_dx": 0.031208712607622147,
      "pose_mae_dy": 0.04385542869567871,
      "pose_rmse_dtheta": 0.24002911150455475,
      "pose_rmse_dx": 0.08943920582532883,
      "pose_rmse_dy": 0.11758933961391449,
      "pose_rmse_mean": 0.14901922643184662,
      "rmse_dtheta": 0.02651730552315712,
      "rmse_dx": 0.01010061614215374,
      "rmse_dy": 0.010072920471429825,
      "rmse_mean": 0.01556361373513937,
      "rotation_flip": 0.004380724858492613,
      "sparse_tokens": 32073.0,
      "step": 1833,
      "turn_loss": 0.13860058784484863,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 39913.0,
      "epoch": 0.0852072105556588,
      "grad_norm": 0.6015029549598694,
      "learning_rate": 9.495707685266992e-06,
      "loss": 0.1563,
      "mae_dtheta": 0.03332773968577385,
      "mae_dx": 0.012212623842060566,
      "mae_dy": 0.004354751203209162,
      "pose_mae_dtheta": 0.2562420666217804,
      "pose_mae_dx": 0.10291393846273422,
      "pose_mae_dy": 0.04896045848727226,
      "pose_rmse_dtheta": 0.46125438809394836,
      "pose_rmse_dx": 0.21812625229358673,
      "pose_rmse_dy": 0.1415627896785736,
      "pose_rmse_mean": 0.27364784479141235,
      "rmse_dtheta": 0.05211690813302994,
      "rmse_dx": 0.024229761213064194,
      "rmse_dy": 0.010693104937672615,
      "rmse_mean": 0.0290132574737072,
      "rotation_flip": 0.012841987423598766,
      "sparse_tokens": 30013.0,
      "step": 1834,
      "turn_loss": 0.26221510767936707,
      "turns": 123.0,
      "turns_per_sample": 123.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08525367032150158,
      "grad_norm": 0.5740447640419006,
      "learning_rate": 9.495128848343212e-06,
      "loss": 0.0833,
      "mae_dtheta": 0.008508564904332161,
      "mae_dx": 0.001756482757627964,
      "mae_dy": 0.0017066800501197577,
      "pose_mae_dtheta": 0.05872577428817749,
      "pose_mae_dx": 0.019543567672371864,
      "pose_mae_dy": 0.02375372126698494,
      "pose_rmse_dtheta": 0.13730721175670624,
      "pose_rmse_dx": 0.04985432326793671,
      "pose_rmse_dy": 0.054775647819042206,
      "pose_rmse_mean": 0.08064573258161545,
      "rmse_dtheta": 0.020197678357362747,
      "rmse_dx": 0.005537891294807196,
      "rmse_dy": 0.003624938428401947,
      "rmse_mean": 0.009786836802959442,
      "rotation_flip": 0.0025445292703807354,
      "sparse_tokens": 32121.0,
      "step": 1835,
      "turn_loss": 0.06764427572488785,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.08530013008734436,
      "grad_norm": 0.682348906993866,
      "learning_rate": 9.494549697072662e-06,
      "loss": 0.1781,
      "mae_dtheta": 0.027844754979014397,
      "mae_dx": 0.012709134258329868,
      "mae_dy": 0.006388400681316853,
      "pose_mae_dtheta": 0.22180946171283722,
      "pose_mae_dx": 0.08896980434656143,
      "pose_mae_dy": 0.06780312210321426,
      "pose_rmse_dtheta": 0.3832807242870331,
      "pose_rmse_dx": 0.21011322736740112,
      "pose_rmse_dy": 0.18195189535617828,
      "pose_rmse_mean": 0.25844860076904297,
      "rmse_dtheta": 0.04297681525349617,
      "rmse_dx": 0.02579130418598652,
      "rmse_dy": 0.014072178862988949,
      "rmse_mean": 0.027613434940576553,
      "rotation_flip": 0.022012578323483467,
      "sparse_tokens": 11381.0,
      "step": 1836,
      "turn_loss": 0.30167365074157715,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.08534658985318715,
      "grad_norm": 0.5137944221496582,
      "learning_rate": 9.493970231495836e-06,
      "loss": 0.1611,
      "mae_dtheta": 0.0136799868196249,
      "mae_dx": 0.0031786055769771338,
      "mae_dy": 0.005485863890498877,
      "pose_mae_dtheta": 0.10147739201784134,
      "pose_mae_dx": 0.046940844506025314,
      "pose_mae_dy": 0.057029951363801956,
      "pose_rmse_dtheta": 0.20130892097949982,
      "pose_rmse_dx": 0.12142118066549301,
      "pose_rmse_dy": 0.13595934212207794,
      "pose_rmse_mean": 0.15289649367332458,
      "rmse_dtheta": 0.02459033578634262,
      "rmse_dx": 0.008414973504841328,
      "rmse_dy": 0.012167843990027905,
      "rmse_mean": 0.015057718381285667,
      "rotation_flip": 0.0048872181214392185,
      "sparse_tokens": 32041.0,
      "step": 1837,
      "turn_loss": 0.14957165718078613,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.08539304961902992,
      "grad_norm": 1.869985580444336,
      "learning_rate": 9.49339045165326e-06,
      "loss": 0.2722,
      "mae_dtheta": 0.04221033677458763,
      "mae_dx": 0.013664399273693562,
      "mae_dy": 0.006116815377026796,
      "pose_mae_dtheta": 0.32037854194641113,
      "pose_mae_dx": 0.10179551690816879,
      "pose_mae_dy": 0.0880277007818222,
      "pose_rmse_dtheta": 0.5529574155807495,
      "pose_rmse_dx": 0.24862751364707947,
      "pose_rmse_dy": 0.18439728021621704,
      "pose_rmse_mean": 0.3286607563495636,
      "rmse_dtheta": 0.06127968803048134,
      "rmse_dx": 0.028149381279945374,
      "rmse_dy": 0.010543630458414555,
      "rmse_mean": 0.033324234187603,
      "rotation_flip": 0.016260161995887756,
      "sparse_tokens": 6509.0,
      "step": 1838,
      "turn_loss": 0.2861855924129486,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0854395093848727,
      "grad_norm": 0.4401691257953644,
      "learning_rate": 9.49281035758548e-06,
      "loss": 0.1185,
      "mae_dtheta": 0.012503290548920631,
      "mae_dx": 0.0021737783681601286,
      "mae_dy": 0.0021898376289755106,
      "pose_mae_dtheta": 0.09026161581277847,
      "pose_mae_dx": 0.027342593297362328,
      "pose_mae_dy": 0.03361360356211662,
      "pose_rmse_dtheta": 0.23272272944450378,
      "pose_rmse_dx": 0.07261994481086731,
      "pose_rmse_dy": 0.08086619526147842,
      "pose_rmse_mean": 0.12873628735542297,
      "rmse_dtheta": 0.027272995561361313,
      "rmse_dx": 0.0071421111933887005,
      "rmse_dy": 0.004332448355853558,
      "rmse_mean": 0.01291585247963667,
      "rotation_flip": 0.007584830280393362,
      "sparse_tokens": 32089.0,
      "step": 1839,
      "turn_loss": 0.09407132118940353,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.08548596915071548,
      "grad_norm": 0.586026668548584,
      "learning_rate": 9.492229949333058e-06,
      "loss": 0.1605,
      "mae_dtheta": 0.03758734092116356,
      "mae_dx": 0.010559848509728909,
      "mae_dy": 0.005792310461401939,
      "pose_mae_dtheta": 0.28120726346969604,
      "pose_mae_dx": 0.09627912193536758,
      "pose_mae_dy": 0.07216306775808334,
      "pose_rmse_dtheta": 0.5030075311660767,
      "pose_rmse_dx": 0.2132488489151001,
      "pose_rmse_dy": 0.1557888239622116,
      "pose_rmse_mean": 0.29068174958229065,
      "rmse_dtheta": 0.05712667107582092,
      "rmse_dx": 0.022508416324853897,
      "rmse_dy": 0.01213274896144867,
      "rmse_mean": 0.030589278787374496,
      "rotation_flip": 0.010218977928161621,
      "sparse_tokens": 11964.0,
      "step": 1840,
      "turn_loss": 0.29514220356941223,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08553242891655827,
      "grad_norm": 0.8354970812797546,
      "learning_rate": 9.491649226936586e-06,
      "loss": 0.1382,
      "mae_dtheta": 0.009566407650709152,
      "mae_dx": 0.0013559680664911866,
      "mae_dy": 0.0018774544587358832,
      "pose_mae_dtheta": 0.06725209206342697,
      "pose_mae_dx": 0.01938595063984394,
      "pose_mae_dy": 0.02521076239645481,
      "pose_rmse_dtheta": 0.18241383135318756,
      "pose_rmse_dx": 0.048505999147892,
      "pose_rmse_dy": 0.06273837387561798,
      "pose_rmse_mean": 0.09788607060909271,
      "rmse_dtheta": 0.022006042301654816,
      "rmse_dx": 0.0040169586427509785,
      "rmse_dy": 0.004022972658276558,
      "rmse_mean": 0.01001532468944788,
      "rotation_flip": 0.0008853474864736199,
      "sparse_tokens": 32089.0,
      "step": 1841,
      "turn_loss": 0.07158457487821579,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.08557888868240104,
      "grad_norm": 0.546914279460907,
      "learning_rate": 9.491068190436671e-06,
      "loss": 0.0762,
      "mae_dtheta": 0.008124052546918392,
      "mae_dx": 0.0015706486301496625,
      "mae_dy": 0.0008801157819107175,
      "pose_mae_dtheta": 0.060046713799238205,
      "pose_mae_dx": 0.013707233592867851,
      "pose_mae_dy": 0.013018493540585041,
      "pose_rmse_dtheta": 0.20877815783023834,
      "pose_rmse_dx": 0.03172118216753006,
      "pose_rmse_dy": 0.03061484917998314,
      "pose_rmse_mean": 0.09037140011787415,
      "rmse_dtheta": 0.024311084300279617,
      "rmse_dx": 0.004626154899597168,
      "rmse_dy": 0.0016754250973463058,
      "rmse_mean": 0.010204222053289413,
      "rotation_flip": 0.004160166252404451,
      "sparse_tokens": 32169.0,
      "step": 1842,
      "turn_loss": 0.06336301565170288,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08562534844824382,
      "grad_norm": 0.6372869610786438,
      "learning_rate": 9.490486839873949e-06,
      "loss": 0.1674,
      "mae_dtheta": 0.012471520341932774,
      "mae_dx": 0.0020961600821465254,
      "mae_dy": 0.003444021800532937,
      "pose_mae_dtheta": 0.08562588691711426,
      "pose_mae_dx": 0.03183727711439133,
      "pose_mae_dy": 0.04359899088740349,
      "pose_rmse_dtheta": 0.18346813321113586,
      "pose_rmse_dx": 0.08093307912349701,
      "pose_rmse_dy": 0.09169579297304153,
      "pose_rmse_mean": 0.11869899928569794,
      "rmse_dtheta": 0.023668736219406128,
      "rmse_dx": 0.006080952472984791,
      "rmse_dy": 0.007395122200250626,
      "rmse_mean": 0.012381603941321373,
      "rotation_flip": 0.008818342350423336,
      "sparse_tokens": 32089.0,
      "step": 1843,
      "turn_loss": 0.11391379684209824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19805.0,
      "epoch": 0.0856718082140866,
      "grad_norm": 0.6977042555809021,
      "learning_rate": 9.489905175289071e-06,
      "loss": 0.1739,
      "mae_dtheta": 0.03314930200576782,
      "mae_dx": 0.013429119251668453,
      "mae_dy": 0.005729088094085455,
      "pose_mae_dtheta": 0.28390738368034363,
      "pose_mae_dx": 0.09704305976629257,
      "pose_mae_dy": 0.06165006011724472,
      "pose_rmse_dtheta": 0.48392748832702637,
      "pose_rmse_dx": 0.23472751677036285,
      "pose_rmse_dy": 0.14134135842323303,
      "pose_rmse_mean": 0.2866654396057129,
      "rmse_dtheta": 0.05006152018904686,
      "rmse_dx": 0.02614627033472061,
      "rmse_dy": 0.011611564084887505,
      "rmse_mean": 0.02927311882376671,
      "rotation_flip": 0.014051522128283978,
      "sparse_tokens": 15119.0,
      "step": 1844,
      "turn_loss": 0.2712198495864868,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 14295.0,
      "epoch": 0.08571826797992937,
      "grad_norm": 0.5114809274673462,
      "learning_rate": 9.489323196722715e-06,
      "loss": 0.1457,
      "mae_dtheta": 0.04113353416323662,
      "mae_dx": 0.014548521488904953,
      "mae_dy": 0.012828435748815536,
      "pose_mae_dtheta": 0.3572400212287903,
      "pose_mae_dx": 0.16460007429122925,
      "pose_mae_dy": 0.11728094518184662,
      "pose_rmse_dtheta": 0.6234156489372253,
      "pose_rmse_dx": 0.31808167695999146,
      "pose_rmse_dy": 0.21447063982486725,
      "pose_rmse_mean": 0.3853226602077484,
      "rmse_dtheta": 0.06160762161016464,
      "rmse_dx": 0.02566639706492424,
      "rmse_dy": 0.022156957536935806,
      "rmse_mean": 0.036476992070674896,
      "rotation_flip": 0.011816838756203651,
      "sparse_tokens": 12108.0,
      "step": 1845,
      "turn_loss": 0.41187870502471924,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.08576472774577217,
      "grad_norm": 1.0652276277542114,
      "learning_rate": 9.488740904215578e-06,
      "loss": 0.2933,
      "mae_dtheta": 0.04306938126683235,
      "mae_dx": 0.01316514890640974,
      "mae_dy": 0.005140410736203194,
      "pose_mae_dtheta": 0.38054996728897095,
      "pose_mae_dx": 0.10712863504886627,
      "pose_mae_dy": 0.05595963075757027,
      "pose_rmse_dtheta": 0.6116894483566284,
      "pose_rmse_dx": 0.20485535264015198,
      "pose_rmse_dy": 0.110753633081913,
      "pose_rmse_mean": 0.3090994954109192,
      "rmse_dtheta": 0.06133798137307167,
      "rmse_dx": 0.02432013861835003,
      "rmse_dy": 0.010023649781942368,
      "rmse_mean": 0.03189392387866974,
      "rotation_flip": 0.01937984488904476,
      "sparse_tokens": 8775.0,
      "step": 1846,
      "turn_loss": 0.2664138674736023,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.08581118751161494,
      "grad_norm": 0.6425701379776001,
      "learning_rate": 9.48815829780838e-06,
      "loss": 0.1088,
      "mae_dtheta": 0.008833752013742924,
      "mae_dx": 0.0022172715980559587,
      "mae_dy": 0.0018983742920681834,
      "pose_mae_dtheta": 0.06796292960643768,
      "pose_mae_dx": 0.025686997920274734,
      "pose_mae_dy": 0.01946551352739334,
      "pose_rmse_dtheta": 0.21754515171051025,
      "pose_rmse_dx": 0.08324329555034637,
      "pose_rmse_dy": 0.06197889894247055,
      "pose_rmse_mean": 0.12092246115207672,
      "rmse_dtheta": 0.025537168607115746,
      "rmse_dx": 0.006121669430285692,
      "rmse_dy": 0.0058323959819972515,
      "rmse_mean": 0.012497078627347946,
      "rotation_flip": 0.0037914691492915154,
      "sparse_tokens": 32185.0,
      "step": 1847,
      "turn_loss": 0.06694140285253525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31143.0,
      "epoch": 0.08585764727745772,
      "grad_norm": 0.5845576524734497,
      "learning_rate": 9.487575377541865e-06,
      "loss": 0.123,
      "mae_dtheta": 0.0338374599814415,
      "mae_dx": 0.012243134900927544,
      "mae_dy": 0.003699979279190302,
      "pose_mae_dtheta": 0.26857277750968933,
      "pose_mae_dx": 0.10746244341135025,
      "pose_mae_dy": 0.0471777506172657,
      "pose_rmse_dtheta": 0.4769805371761322,
      "pose_rmse_dx": 0.23758439719676971,
      "pose_rmse_dy": 0.11890622228384018,
      "pose_rmse_mean": 0.27782371640205383,
      "rmse_dtheta": 0.051758818328380585,
      "rmse_dx": 0.025057438760995865,
      "rmse_dy": 0.007423603441566229,
      "rmse_mean": 0.028079954907298088,
      "rotation_flip": 0.005511811003088951,
      "sparse_tokens": 26169.0,
      "step": 1848,
      "turn_loss": 0.24267084896564484,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.0859041070433005,
      "grad_norm": 0.6632103323936462,
      "learning_rate": 9.486992143456792e-06,
      "loss": 0.1888,
      "mae_dtheta": 0.03789079561829567,
      "mae_dx": 0.02176770381629467,
      "mae_dy": 0.006236292887479067,
      "pose_mae_dtheta": 0.32081669569015503,
      "pose_mae_dx": 0.175959050655365,
      "pose_mae_dy": 0.06559624522924423,
      "pose_rmse_dtheta": 0.5037620663642883,
      "pose_rmse_dx": 0.3449253439903259,
      "pose_rmse_dy": 0.1378198117017746,
      "pose_rmse_mean": 0.32883575558662415,
      "rmse_dtheta": 0.05285799875855446,
      "rmse_dx": 0.03593672439455986,
      "rmse_dy": 0.011310282163321972,
      "rmse_mean": 0.03336833417415619,
      "rotation_flip": 0.007276507094502449,
      "sparse_tokens": 17909.0,
      "step": 1849,
      "turn_loss": 0.3005470335483551,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08595056680914329,
      "grad_norm": 0.514267086982727,
      "learning_rate": 9.486408595593953e-06,
      "loss": 0.0909,
      "mae_dtheta": 0.01287797186523676,
      "mae_dx": 0.002604792360216379,
      "mae_dy": 0.0036551400553435087,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5142673254013062,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.80740356445312,
      "model/head/act_norm_mean": 105.99403211805556,
      "model/head/act_norm_min": 51.28632736206055,
      "model/head/act_over_embed": 72.84009120329091,
      "model/head/grad_frac": 0.09963277727365494,
      "model/head/grad_norm": 0.05123788118362427,
      "model/head/grad_zero_frac": 0.0001729131181491539,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6922249842171717,
      "model/head/update_ratio": 0.0008894039783626795,
      "model/head/weight_delta": 4.907272815704346,
      "model/head/weight_delta_rel": 0.08608809858560562,
      "model/head/weight_norm": 57.60923385620117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4140217900276184,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4139529267047865,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4138880968093872,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2844723267198884,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08585874736309052,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04415434971451759,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5313118636877828,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001436013844795525,
      "model/modality_embedder.encoders.pose/weight_delta": 1.5870885848999023,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05185513198375702,
      "model/modality_embedder.encoders.pose/weight_norm": 30.74785804748535,
      "model/modality_embedder/grad_frac": 0.08585874736309052,
      "model/modality_embedder/grad_norm": 0.04415434971451759,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5313118636877828,
      "model/modality_embedder/update_ratio": 0.001436013844795525,
      "model/modality_embedder/weight_delta": 1.5870885848999023,
      "model/modality_embedder/weight_delta_rel": 0.05185513198375702,
      "model/modality_embedder/weight_norm": 30.74785804748535,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.02117156982422,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.073505391213725,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.925580024719238,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.856328922402957,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08246930688619614,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04241127148270607,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001537191797979176,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.9448726773262024,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03443172946572304,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.590097427368164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.41732788085938,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.155388207471542,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.287233352661133,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.599808922481834,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08418294787406921,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.043292541056871414,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014855638146400452,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.172532558441162,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0406174436211586,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.142162322998047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.26870727539062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.14163961038961,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.698284149169922,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.964779482145744,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08871027827262878,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04562079906463623,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00151704135350883,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.246477484703064,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0418543815612793,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.07221794128418,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.1358871459961,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.076291185666186,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.738122940063477,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.294290157169222,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09612880647182465,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04943590611219406,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 8.069722389336675e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016774024115875363,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.0648798942565918,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.036392539739608765,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.471702575683594,
      "model/normalizer/grad_frac": 0.38352465629577637,
      "model/normalizer/grad_norm": 0.19723419845104218,
      "model/normalizer/grad_zero_frac": 0.00011226515198359266,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0025303110014647245,
      "model/normalizer/weight_delta": 2.2798757553100586,
      "model/normalizer/weight_delta_rel": 0.0293634794652462,
      "model/normalizer/weight_norm": 77.94860076904297,
      "pose_mae_dtheta": 0.09491690248250961,
      "pose_mae_dx": 0.033871326595544815,
      "pose_mae_dy": 0.04106742888689041,
      "pose_rmse_dtheta": 0.20685824751853943,
      "pose_rmse_dx": 0.08410504460334778,
      "pose_rmse_dy": 0.11100494861602783,
      "pose_rmse_mean": 0.13398942351341248,
      "rmse_dtheta": 0.025294607505202293,
      "rmse_dx": 0.007019244134426117,
      "rmse_dy": 0.008392809890210629,
      "rmse_mean": 0.013568888418376446,
      "rotation_flip": 0.003957261797040701,
      "sparse_tokens": 32089.0,
      "step": 1850,
      "turn_loss": 0.12141911685466766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.08599702657498606,
      "grad_norm": 0.707676887512207,
      "learning_rate": 9.485824733994151e-06,
      "loss": 0.1689,
      "mae_dtheta": 0.010998436249792576,
      "mae_dx": 0.002357381395995617,
      "mae_dy": 0.0016048161778599024,
      "pose_mae_dtheta": 0.08294262737035751,
      "pose_mae_dx": 0.02311665192246437,
      "pose_mae_dy": 0.02243259735405445,
      "pose_rmse_dtheta": 0.25385281443595886,
      "pose_rmse_dx": 0.06296344101428986,
      "pose_rmse_dy": 0.06412151455879211,
      "pose_rmse_mean": 0.126979261636734,
      "rmse_dtheta": 0.027752986177802086,
      "rmse_dx": 0.007589502725750208,
      "rmse_dy": 0.004228149075061083,
      "rmse_mean": 0.013190212659537792,
      "rotation_flip": 0.00388538115657866,
      "sparse_tokens": 32105.0,
      "step": 1851,
      "turn_loss": 0.08479806035757065,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.08604348634082884,
      "grad_norm": 0.4413101077079773,
      "learning_rate": 9.485240558698219e-06,
      "loss": 0.2051,
      "mae_dtheta": 0.010792623274028301,
      "mae_dx": 0.003095528343692422,
      "mae_dy": 0.001674818922765553,
      "pose_mae_dtheta": 0.0723733901977539,
      "pose_mae_dx": 0.03133288770914078,
      "pose_mae_dy": 0.019736776128411293,
      "pose_rmse_dtheta": 0.17926006019115448,
      "pose_rmse_dx": 0.07339806854724884,
      "pose_rmse_dy": 0.04382680729031563,
      "pose_rmse_mean": 0.09882831573486328,
      "rmse_dtheta": 0.02317994460463524,
      "rmse_dx": 0.009154143743216991,
      "rmse_dy": 0.0033796122297644615,
      "rmse_mean": 0.01190456748008728,
      "rotation_flip": 0.004338394850492477,
      "sparse_tokens": 32105.0,
      "step": 1852,
      "turn_loss": 0.1288800835609436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.08608994610667162,
      "grad_norm": 0.6405226588249207,
      "learning_rate": 9.484656069747007e-06,
      "loss": 0.1103,
      "mae_dtheta": 0.011401332914829254,
      "mae_dx": 0.0025496636517345905,
      "mae_dy": 0.0023615537211298943,
      "pose_mae_dtheta": 0.08512936532497406,
      "pose_mae_dx": 0.029207559302449226,
      "pose_mae_dy": 0.03370887413620949,
      "pose_rmse_dtheta": 0.21464233100414276,
      "pose_rmse_dx": 0.07575847208499908,
      "pose_rmse_dy": 0.07989288866519928,
      "pose_rmse_mean": 0.12343122810125351,
      "rmse_dtheta": 0.024876976385712624,
      "rmse_dx": 0.0076134223490953445,
      "rmse_dy": 0.004744823090732098,
      "rmse_mean": 0.01241174153983593,
      "rotation_flip": 0.0033795200288295746,
      "sparse_tokens": 32185.0,
      "step": 1853,
      "turn_loss": 0.10437686741352081,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.08613640587251441,
      "grad_norm": 0.947474479675293,
      "learning_rate": 9.484071267181387e-06,
      "loss": 0.1073,
      "mae_dtheta": 0.010493485257029533,
      "mae_dx": 0.0016616827342659235,
      "mae_dy": 0.0017125450540333986,
      "pose_mae_dtheta": 0.0797513946890831,
      "pose_mae_dx": 0.01942385546863079,
      "pose_mae_dy": 0.025730114430189133,
      "pose_rmse_dtheta": 0.21745730936527252,
      "pose_rmse_dx": 0.05391048640012741,
      "pose_rmse_dy": 0.055557310581207275,
      "pose_rmse_mean": 0.10897503793239594,
      "rmse_dtheta": 0.024349309504032135,
      "rmse_dx": 0.0058968388475477695,
      "rmse_dy": 0.003638095688074827,
      "rmse_mean": 0.011294747702777386,
      "rotation_flip": 0.0033984705805778503,
      "sparse_tokens": 32057.0,
      "step": 1854,
      "turn_loss": 0.07833701372146606,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.08618286563835718,
      "grad_norm": 0.4234994649887085,
      "learning_rate": 9.483486151042258e-06,
      "loss": 0.0771,
      "mae_dtheta": 0.010400847531855106,
      "mae_dx": 0.0021218489855527878,
      "mae_dy": 0.0018968271324411035,
      "pose_mae_dtheta": 0.07774187624454498,
      "pose_mae_dx": 0.019545184448361397,
      "pose_mae_dy": 0.02375570684671402,
      "pose_rmse_dtheta": 0.21809639036655426,
      "pose_rmse_dx": 0.054344162344932556,
      "pose_rmse_dy": 0.05797947570681572,
      "pose_rmse_mean": 0.11014001071453094,
      "rmse_dtheta": 0.024149388074874878,
      "rmse_dx": 0.006996773183345795,
      "rmse_dy": 0.005128907505422831,
      "rmse_mean": 0.012091690674424171,
      "rotation_flip": 0.006420545745640993,
      "sparse_tokens": 32153.0,
      "step": 1855,
      "turn_loss": 0.09474775195121765,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.08622932540419996,
      "grad_norm": 0.5701251029968262,
      "learning_rate": 9.482900721370538e-06,
      "loss": 0.1551,
      "mae_dtheta": 0.04612886905670166,
      "mae_dx": 0.016201110556721687,
      "mae_dy": 0.006156016606837511,
      "pose_mae_dtheta": 0.3992500305175781,
      "pose_mae_dx": 0.1420697569847107,
      "pose_mae_dy": 0.07500238716602325,
      "pose_rmse_dtheta": 0.6881709694862366,
      "pose_rmse_dx": 0.2812614440917969,
      "pose_rmse_dy": 0.15324488282203674,
      "pose_rmse_mean": 0.37422579526901245,
      "rmse_dtheta": 0.0663677453994751,
      "rmse_dx": 0.029274284839630127,
      "rmse_dy": 0.011759469285607338,
      "rmse_mean": 0.035800501704216,
      "rotation_flip": 0.019031140953302383,
      "sparse_tokens": 8882.0,
      "step": 1856,
      "turn_loss": 0.34004008769989014,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.08627578517004274,
      "grad_norm": 0.6786481738090515,
      "learning_rate": 9.48231497820716e-06,
      "loss": 0.1162,
      "mae_dtheta": 0.012864467687904835,
      "mae_dx": 0.00219958764500916,
      "mae_dy": 0.0031298997346311808,
      "pose_mae_dtheta": 0.09463206678628922,
      "pose_mae_dx": 0.03451506420969963,
      "pose_mae_dy": 0.04175611957907677,
      "pose_rmse_dtheta": 0.21955431997776031,
      "pose_rmse_dx": 0.11136287450790405,
      "pose_rmse_dy": 0.10203442722558975,
      "pose_rmse_mean": 0.14431720972061157,
      "rmse_dtheta": 0.025656506419181824,
      "rmse_dx": 0.007691056467592716,
      "rmse_dy": 0.008023553527891636,
      "rmse_mean": 0.0137903718277812,
      "rotation_flip": 0.0022530979476869106,
      "sparse_tokens": 32073.0,
      "step": 1857,
      "turn_loss": 0.08968765288591385,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.08632224493588553,
      "grad_norm": 0.8100892901420593,
      "learning_rate": 9.481728921593095e-06,
      "loss": 0.0747,
      "mae_dtheta": 0.008384891785681248,
      "mae_dx": 0.0019939530175179243,
      "mae_dy": 0.0017707142978906631,
      "pose_mae_dtheta": 0.060589492321014404,
      "pose_mae_dx": 0.02630254067480564,
      "pose_mae_dy": 0.026640400290489197,
      "pose_rmse_dtheta": 0.13832248747348785,
      "pose_rmse_dx": 0.06148883327841759,
      "pose_rmse_dy": 0.06639505177736282,
      "pose_rmse_mean": 0.08873546123504639,
      "rmse_dtheta": 0.01837557926774025,
      "rmse_dx": 0.006030843127518892,
      "rmse_dy": 0.0035345847718417645,
      "rmse_mean": 0.009313669055700302,
      "rotation_flip": 0.002623524283990264,
      "sparse_tokens": 32105.0,
      "step": 1858,
      "turn_loss": 0.0645180344581604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.0863687047017283,
      "grad_norm": 0.4689792990684509,
      "learning_rate": 9.481142551569318e-06,
      "loss": 0.1406,
      "mae_dtheta": 0.024596018716692924,
      "mae_dx": 0.018090907484292984,
      "mae_dy": 0.0034897413570433855,
      "pose_mae_dtheta": 0.16915340721607208,
      "pose_mae_dx": 0.17423878610134125,
      "pose_mae_dy": 0.04258064553141594,
      "pose_rmse_dtheta": 0.2804901897907257,
      "pose_rmse_dx": 0.3600257337093353,
      "pose_rmse_dy": 0.10751304775476456,
      "pose_rmse_mean": 0.24934300780296326,
      "rmse_dtheta": 0.037249140441417694,
      "rmse_dx": 0.03286636993288994,
      "rmse_dy": 0.006847284268587828,
      "rmse_mean": 0.02565426379442215,
      "rotation_flip": 0.0039840638637542725,
      "sparse_tokens": 9381.0,
      "step": 1859,
      "turn_loss": 0.2315947413444519,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08641516446757108,
      "grad_norm": 0.5211482644081116,
      "learning_rate": 9.480555868176837e-06,
      "loss": 0.1221,
      "mae_dtheta": 0.014631091617047787,
      "mae_dx": 0.002528747543692589,
      "mae_dy": 0.003066909732297063,
      "pose_mae_dtheta": 0.09932629764080048,
      "pose_mae_dx": 0.03022587113082409,
      "pose_mae_dy": 0.0371151864528656,
      "pose_rmse_dtheta": 0.20970678329467773,
      "pose_rmse_dx": 0.0767936035990715,
      "pose_rmse_dy": 0.08510101586580276,
      "pose_rmse_mean": 0.12386713922023773,
      "rmse_dtheta": 0.027321241796016693,
      "rmse_dx": 0.007183666806668043,
      "rmse_dy": 0.006289163138717413,
      "rmse_mean": 0.013598023913800716,
      "rotation_flip": 0.011319281533360481,
      "sparse_tokens": 32121.0,
      "step": 1860,
      "turn_loss": 0.13266727328300476,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08646162423341386,
      "grad_norm": 0.7368669509887695,
      "learning_rate": 9.47996887145668e-06,
      "loss": 0.116,
      "mae_dtheta": 0.005204384680837393,
      "mae_dx": 0.004986475221812725,
      "mae_dy": 0.0007389780948869884,
      "pose_mae_dtheta": 0.04099620506167412,
      "pose_mae_dx": 0.04441775009036064,
      "pose_mae_dy": 0.010542408563196659,
      "pose_rmse_dtheta": 0.1402398943901062,
      "pose_rmse_dx": 0.14616836607456207,
      "pose_rmse_dy": 0.032104361802339554,
      "pose_rmse_mean": 0.10617087781429291,
      "rmse_dtheta": 0.016116991639137268,
      "rmse_dx": 0.014750047586858273,
      "rmse_dy": 0.0029765355866402388,
      "rmse_mean": 0.011281192302703857,
      "rotation_flip": 0.005547850392758846,
      "sparse_tokens": 32089.0,
      "step": 1861,
      "turn_loss": 0.06345314532518387,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.08650808399925665,
      "grad_norm": 0.48424968123435974,
      "learning_rate": 9.479381561449895e-06,
      "loss": 0.077,
      "mae_dtheta": 0.010508994571864605,
      "mae_dx": 0.0012178155593574047,
      "mae_dy": 0.0020565870217978954,
      "pose_mae_dtheta": 0.07952921092510223,
      "pose_mae_dx": 0.020706992596387863,
      "pose_mae_dy": 0.03456619754433632,
      "pose_rmse_dtheta": 0.1831459254026413,
      "pose_rmse_dx": 0.05596128851175308,
      "pose_rmse_dy": 0.08857553452253342,
      "pose_rmse_mean": 0.10922759026288986,
      "rmse_dtheta": 0.021503698080778122,
      "rmse_dx": 0.0041663614101707935,
      "rmse_dy": 0.004299999680370092,
      "rmse_mean": 0.009990019723773003,
      "rotation_flip": 0.004476275760680437,
      "sparse_tokens": 32041.0,
      "step": 1862,
      "turn_loss": 0.07089125365018845,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.08655454376509943,
      "grad_norm": 0.48713424801826477,
      "learning_rate": 9.478793938197554e-06,
      "loss": 0.085,
      "mae_dtheta": 0.011508400551974773,
      "mae_dx": 0.0022566281259059906,
      "mae_dy": 0.003300182521343231,
      "pose_mae_dtheta": 0.08166015893220901,
      "pose_mae_dx": 0.03403107821941376,
      "pose_mae_dy": 0.03843875974416733,
      "pose_rmse_dtheta": 0.1611095368862152,
      "pose_rmse_dx": 0.08895716816186905,
      "pose_rmse_dy": 0.08889392018318176,
      "pose_rmse_mean": 0.11298687756061554,
      "rmse_dtheta": 0.0202107522636652,
      "rmse_dx": 0.00659047020599246,
      "rmse_dy": 0.006534311454743147,
      "rmse_mean": 0.011111844331026077,
      "rotation_flip": 0.0030050084460526705,
      "sparse_tokens": 32105.0,
      "step": 1863,
      "turn_loss": 0.11045876890420914,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.0866010035309422,
      "grad_norm": 0.5989260077476501,
      "learning_rate": 9.47820600174075e-06,
      "loss": 0.1663,
      "mae_dtheta": 0.030635735020041466,
      "mae_dx": 0.012788783758878708,
      "mae_dy": 0.003926310688257217,
      "pose_mae_dtheta": 0.2737790048122406,
      "pose_mae_dx": 0.10097339749336243,
      "pose_mae_dy": 0.05017871409654617,
      "pose_rmse_dtheta": 0.4925331473350525,
      "pose_rmse_dx": 0.22782739996910095,
      "pose_rmse_dy": 0.13222233951091766,
      "pose_rmse_mean": 0.28419429063796997,
      "rmse_dtheta": 0.0490528866648674,
      "rmse_dx": 0.02502003312110901,
      "rmse_dy": 0.0074196164496243,
      "rmse_mean": 0.02716417983174324,
      "rotation_flip": 0.013966480270028114,
      "sparse_tokens": 14402.0,
      "step": 1864,
      "turn_loss": 0.2783413827419281,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 32338.0,
      "epoch": 0.08664746329678498,
      "grad_norm": 0.3856211006641388,
      "learning_rate": 9.477617752120593e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.035683996975421906,
      "mae_dx": 0.013352980837225914,
      "mae_dy": 0.006566825322806835,
      "pose_mae_dtheta": 0.3003935217857361,
      "pose_mae_dx": 0.10028646886348724,
      "pose_mae_dy": 0.07340908795595169,
      "pose_rmse_dtheta": 0.5308930277824402,
      "pose_rmse_dx": 0.21955780684947968,
      "pose_rmse_dy": 0.16442418098449707,
      "pose_rmse_mean": 0.3049583435058594,
      "rmse_dtheta": 0.05404006689786911,
      "rmse_dx": 0.025817828252911568,
      "rmse_dy": 0.015034206211566925,
      "rmse_mean": 0.03163070231676102,
      "rotation_flip": 0.013812154531478882,
      "sparse_tokens": 25499.0,
      "step": 1865,
      "turn_loss": 0.26805397868156433,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.08669392306262777,
      "grad_norm": 0.4740596115589142,
      "learning_rate": 9.477029189378226e-06,
      "loss": 0.1463,
      "mae_dtheta": 0.03756134957075119,
      "mae_dx": 0.00551040330901742,
      "mae_dy": 0.0032362560741603374,
      "pose_mae_dtheta": 0.29144036769866943,
      "pose_mae_dx": 0.04744809493422508,
      "pose_mae_dy": 0.027153586968779564,
      "pose_rmse_dtheta": 0.5036476254463196,
      "pose_rmse_dx": 0.10632582753896713,
      "pose_rmse_dy": 0.06907970458269119,
      "pose_rmse_mean": 0.2263510525226593,
      "rmse_dtheta": 0.05619318038225174,
      "rmse_dx": 0.012773287482559681,
      "rmse_dy": 0.008715176954865456,
      "rmse_mean": 0.025893881916999817,
      "rotation_flip": 0.015463917516171932,
      "sparse_tokens": 16046.0,
      "step": 1866,
      "turn_loss": 0.2839509844779968,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.08674038282847055,
      "grad_norm": 0.5204829573631287,
      "learning_rate": 9.476440313554803e-06,
      "loss": 0.1234,
      "mae_dtheta": 0.0358174629509449,
      "mae_dx": 0.019371643662452698,
      "mae_dy": 0.007148997392505407,
      "pose_mae_dtheta": 0.2767091393470764,
      "pose_mae_dx": 0.1353837251663208,
      "pose_mae_dy": 0.11010018736124039,
      "pose_rmse_dtheta": 0.41969433426856995,
      "pose_rmse_dx": 0.2645079791545868,
      "pose_rmse_dy": 0.2067728340625763,
      "pose_rmse_mean": 0.2969917058944702,
      "rmse_dtheta": 0.04994365945458412,
      "rmse_dx": 0.032553620636463165,
      "rmse_dy": 0.011742433533072472,
      "rmse_mean": 0.0314132422208786,
      "rotation_flip": 0.002369668334722519,
      "sparse_tokens": 6866.0,
      "step": 1867,
      "turn_loss": 0.34937456250190735,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.08678684259431332,
      "grad_norm": 0.4749959707260132,
      "learning_rate": 9.475851124691508e-06,
      "loss": 0.0853,
      "mae_dtheta": 0.008780024945735931,
      "mae_dx": 0.0023272959515452385,
      "mae_dy": 0.0024417717941105366,
      "pose_mae_dtheta": 0.059529297053813934,
      "pose_mae_dx": 0.023955218493938446,
      "pose_mae_dy": 0.02405972220003605,
      "pose_rmse_dtheta": 0.1725759655237198,
      "pose_rmse_dx": 0.0775800496339798,
      "pose_rmse_dy": 0.0645112693309784,
      "pose_rmse_mean": 0.10488909482955933,
      "rmse_dtheta": 0.022500352934002876,
      "rmse_dx": 0.007930479943752289,
      "rmse_dy": 0.00694226985797286,
      "rmse_mean": 0.012457701377570629,
      "rotation_flip": 0.007751937955617905,
      "sparse_tokens": 32041.0,
      "step": 1868,
      "turn_loss": 0.08216942846775055,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30723.0,
      "epoch": 0.0868333023601561,
      "grad_norm": 0.44207027554512024,
      "learning_rate": 9.47526162282954e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.030490783974528313,
      "mae_dx": 0.011194118298590183,
      "mae_dy": 0.0031091978307813406,
      "pose_mae_dtheta": 0.25015097856521606,
      "pose_mae_dx": 0.09211131930351257,
      "pose_mae_dy": 0.05743284896016121,
      "pose_rmse_dtheta": 0.47024106979370117,
      "pose_rmse_dx": 0.24473989009857178,
      "pose_rmse_dy": 0.1189141720533371,
      "pose_rmse_mean": 0.27796506881713867,
      "rmse_dtheta": 0.04819323122501373,
      "rmse_dx": 0.02534191682934761,
      "rmse_dy": 0.005444140173494816,
      "rmse_mean": 0.026326429098844528,
      "rotation_flip": 0.010054844431579113,
      "sparse_tokens": 25305.0,
      "step": 1869,
      "turn_loss": 0.20493046939373016,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.08687976212599889,
      "grad_norm": 0.2938486337661743,
      "learning_rate": 9.474671808010126e-06,
      "loss": 0.1048,
      "mae_dtheta": 0.04519031196832657,
      "mae_dx": 0.010986515320837498,
      "mae_dy": 0.00782656017690897,
      "pose_mae_dtheta": 0.3688964545726776,
      "pose_mae_dx": 0.07128618657588959,
      "pose_mae_dy": 0.08086007088422775,
      "pose_rmse_dtheta": 0.6147710680961609,
      "pose_rmse_dx": 0.18012787401676178,
      "pose_rmse_dy": 0.15814228355884552,
      "pose_rmse_mean": 0.3176804184913635,
      "rmse_dtheta": 0.06481507420539856,
      "rmse_dx": 0.022962229326367378,
      "rmse_dy": 0.01457739993929863,
      "rmse_mean": 0.03411823511123657,
      "rotation_flip": 0.01820388436317444,
      "sparse_tokens": 13059.0,
      "step": 1870,
      "turn_loss": 0.3840774595737457,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.08692622189184167,
      "grad_norm": 0.6014286875724792,
      "learning_rate": 9.47408168027451e-06,
      "loss": 0.1659,
      "mae_dtheta": 0.042296960949897766,
      "mae_dx": 0.007206054870039225,
      "mae_dy": 0.00571397366002202,
      "pose_mae_dtheta": 0.31531867384910583,
      "pose_mae_dx": 0.04787395894527435,
      "pose_mae_dy": 0.05992535874247551,
      "pose_rmse_dtheta": 0.5103788375854492,
      "pose_rmse_dx": 0.11458875238895416,
      "pose_rmse_dy": 0.13125233352184296,
      "pose_rmse_mean": 0.2520733177661896,
      "rmse_dtheta": 0.06121391803026199,
      "rmse_dx": 0.016660626977682114,
      "rmse_dy": 0.0121242580935359,
      "rmse_mean": 0.02999959886074066,
      "rotation_flip": 0.017897091805934906,
      "sparse_tokens": 7777.0,
      "step": 1871,
      "turn_loss": 0.2480745017528534,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.08697268165768444,
      "grad_norm": 0.5780700445175171,
      "learning_rate": 9.473491239663961e-06,
      "loss": 0.1934,
      "mae_dtheta": 0.04135226458311081,
      "mae_dx": 0.018382811918854713,
      "mae_dy": 0.005628766026347876,
      "pose_mae_dtheta": 0.34170666337013245,
      "pose_mae_dx": 0.14102013409137726,
      "pose_mae_dy": 0.06551425158977509,
      "pose_rmse_dtheta": 0.6067373752593994,
      "pose_rmse_dx": 0.2970154583454132,
      "pose_rmse_dy": 0.14831259846687317,
      "pose_rmse_mean": 0.35068845748901367,
      "rmse_dtheta": 0.06235712766647339,
      "rmse_dx": 0.03186560422182083,
      "rmse_dy": 0.011832986027002335,
      "rmse_mean": 0.03535190969705582,
      "rotation_flip": 0.01604278013110161,
      "sparse_tokens": 12148.0,
      "step": 1872,
      "turn_loss": 0.3999393582344055,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.08701914142352722,
      "grad_norm": 0.5744524598121643,
      "learning_rate": 9.47290048621977e-06,
      "loss": 0.2125,
      "mae_dtheta": 0.03743681311607361,
      "mae_dx": 0.01157444529235363,
      "mae_dy": 0.005437405779957771,
      "pose_mae_dtheta": 0.285304993391037,
      "pose_mae_dx": 0.07575727999210358,
      "pose_mae_dy": 0.06511285901069641,
      "pose_rmse_dtheta": 0.4865987002849579,
      "pose_rmse_dx": 0.19332289695739746,
      "pose_rmse_dy": 0.1617218405008316,
      "pose_rmse_mean": 0.2805478274822235,
      "rmse_dtheta": 0.055875055491924286,
      "rmse_dx": 0.023888248950242996,
      "rmse_dy": 0.01165558211505413,
      "rmse_mean": 0.03047296404838562,
      "rotation_flip": 0.004566209856420755,
      "sparse_tokens": 17432.0,
      "step": 1873,
      "turn_loss": 0.3355962932109833,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 22072.0,
      "epoch": 0.08706560118937001,
      "grad_norm": 0.7016830444335938,
      "learning_rate": 9.472309419983245e-06,
      "loss": 0.124,
      "mae_dtheta": 0.02810693345963955,
      "mae_dx": 0.011686037294566631,
      "mae_dy": 0.0034202449023723602,
      "pose_mae_dtheta": 0.21819745004177094,
      "pose_mae_dx": 0.09695090353488922,
      "pose_mae_dy": 0.04192567616701126,
      "pose_rmse_dtheta": 0.4302462637424469,
      "pose_rmse_dx": 0.23641057312488556,
      "pose_rmse_dy": 0.09948106110095978,
      "pose_rmse_mean": 0.255379319190979,
      "rmse_dtheta": 0.04656388238072395,
      "rmse_dx": 0.024880243465304375,
      "rmse_dy": 0.007538584526628256,
      "rmse_mean": 0.026327570900321007,
      "rotation_flip": 0.010688835754990578,
      "sparse_tokens": 17615.0,
      "step": 1874,
      "turn_loss": 0.2069922238588333,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 32438.0,
      "epoch": 0.08711206095521279,
      "grad_norm": 0.5166669487953186,
      "learning_rate": 9.471718040995722e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.02337442897260189,
      "mae_dx": 0.008350052870810032,
      "mae_dy": 0.0046590170823037624,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.516666829586029,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.7957000732422,
      "model/head/act_norm_mean": 115.90595703125,
      "model/head/act_norm_min": 69.06598663330078,
      "model/head/act_over_embed": 79.6516588005412,
      "model/head/grad_frac": 0.10041365027427673,
      "model/head/grad_norm": 0.051880400627851486,
      "model/head/grad_zero_frac": 0.00018084491603076458,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.68990234375,
      "model/head/update_ratio": 0.0009004325256682932,
      "model/head/weight_delta": 4.942817687988281,
      "model/head/weight_delta_rel": 0.08671166002750397,
      "model/head/weight_norm": 57.6171989440918,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4140540659427643,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4139980656085628,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41391780972480774,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28450334659716053,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0927228257060051,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04790680855512619,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.4547493811881188,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015579062746837735,
      "model/modality_embedder.encoders.pose/weight_delta": 1.5999634265899658,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05227579176425934,
      "model/modality_embedder.encoders.pose/weight_norm": 30.750764846801758,
      "model/modality_embedder/grad_frac": 0.0927228257060051,
      "model/modality_embedder/grad_norm": 0.04790680855512619,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.4547493811881188,
      "model/modality_embedder/update_ratio": 0.0015579062746837735,
      "model/modality_embedder/weight_delta": 1.5999634265899658,
      "model/modality_embedder/weight_delta_rel": 0.05227579176425934,
      "model/modality_embedder/weight_norm": 30.750764846801758,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.20275115966797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.913333333333334,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.033296585083008,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.433466546820622,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0874493420124054,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04518217593431473,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016375191044062376,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.955849289894104,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03483172506093979,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.591846466064453,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.70745086669922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.836502976190477,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.601594924926758,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.067877368242417,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09159460663795471,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04732389375567436,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016237852396443486,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.1852549314498901,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04105815663933754,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.144182205200195,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.58303833007812,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.56339285714286,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.97248363494873,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.254612261830683,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0942971333861351,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04872019961476326,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016199912643060088,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.259873628616333,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04230419918894768,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.074359893798828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.20755767822266,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.524732142857143,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.99953842163086,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.602462981321235,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09200434386730194,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.047535594552755356,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016128560528159142,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.0762841701507568,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03678228706121445,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.472930908203125,
      "model/normalizer/grad_frac": 0.32158076763153076,
      "model/normalizer/grad_norm": 0.16615010797977448,
      "model/normalizer/grad_zero_frac": 0.00016426164074800909,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021314469631761312,
      "model/normalizer/weight_delta": 2.30495023727417,
      "model/normalizer/weight_delta_rel": 0.029686424881219864,
      "model/normalizer/weight_norm": 77.95178985595703,
      "pose_mae_dtheta": 0.18185853958129883,
      "pose_mae_dx": 0.06237958371639252,
      "pose_mae_dy": 0.06248224899172783,
      "pose_rmse_dtheta": 0.358877569437027,
      "pose_rmse_dx": 0.1659901738166809,
      "pose_rmse_dy": 0.13521453738212585,
      "pose_rmse_mean": 0.22002744674682617,
      "rmse_dtheta": 0.039973169565200806,
      "rmse_dx": 0.02118595689535141,
      "rmse_dy": 0.009770620614290237,
      "rmse_mean": 0.02364325150847435,
      "rotation_flip": 0.010824313387274742,
      "sparse_tokens": 26558.0,
      "step": 1875,
      "turn_loss": 0.18176621198654175,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.08715852072105557,
      "grad_norm": 0.8440051674842834,
      "learning_rate": 9.471126349298557e-06,
      "loss": 0.2049,
      "mae_dtheta": 0.02939767576754093,
      "mae_dx": 0.014796650968492031,
      "mae_dy": 0.006755839567631483,
      "pose_mae_dtheta": 0.27161288261413574,
      "pose_mae_dx": 0.13306361436843872,
      "pose_mae_dy": 0.10248463600873947,
      "pose_rmse_dtheta": 0.43709707260131836,
      "pose_rmse_dx": 0.2920939028263092,
      "pose_rmse_dy": 0.23073093593120575,
      "pose_rmse_mean": 0.31997397541999817,
      "rmse_dtheta": 0.044227998703718185,
      "rmse_dx": 0.029277699068188667,
      "rmse_dy": 0.013333752751350403,
      "rmse_mean": 0.028946485370397568,
      "rotation_flip": 0.011937557719647884,
      "sparse_tokens": 21174.0,
      "step": 1876,
      "turn_loss": 0.29645004868507385,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08720498048689834,
      "grad_norm": 0.4071645140647888,
      "learning_rate": 9.470534344933127e-06,
      "loss": 0.0922,
      "mae_dtheta": 0.010082339867949486,
      "mae_dx": 0.002269977703690529,
      "mae_dy": 0.0017359500052407384,
      "pose_mae_dtheta": 0.0709732323884964,
      "pose_mae_dx": 0.02473136968910694,
      "pose_mae_dy": 0.021373393014073372,
      "pose_rmse_dtheta": 0.2028302103281021,
      "pose_rmse_dx": 0.06821823865175247,
      "pose_rmse_dy": 0.05562343820929527,
      "pose_rmse_mean": 0.10889063775539398,
      "rmse_dtheta": 0.025568217039108276,
      "rmse_dx": 0.006374946795403957,
      "rmse_dy": 0.004580597393214703,
      "rmse_mean": 0.012174587696790695,
      "rotation_flip": 0.005011135712265968,
      "sparse_tokens": 32121.0,
      "step": 1877,
      "turn_loss": 0.0839323177933693,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.08725144025274112,
      "grad_norm": 0.4873877465724945,
      "learning_rate": 9.46994202794083e-06,
      "loss": 0.1019,
      "mae_dtheta": 0.03059873916208744,
      "mae_dx": 0.011302155442535877,
      "mae_dy": 0.007416371256113052,
      "pose_mae_dtheta": 0.2504955530166626,
      "pose_mae_dx": 0.08960949629545212,
      "pose_mae_dy": 0.09782379865646362,
      "pose_rmse_dtheta": 0.4215286076068878,
      "pose_rmse_dx": 0.19592192769050598,
      "pose_rmse_dy": 0.19667485356330872,
      "pose_rmse_mean": 0.2713751494884491,
      "rmse_dtheta": 0.045256201177835464,
      "rmse_dx": 0.023414744064211845,
      "rmse_dy": 0.012640849687159061,
      "rmse_mean": 0.027103930711746216,
      "rotation_flip": 0.0072614108212292194,
      "sparse_tokens": 17899.0,
      "step": 1878,
      "turn_loss": 0.290138304233551,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08729790001858391,
      "grad_norm": 0.559746503829956,
      "learning_rate": 9.469349398363088e-06,
      "loss": 0.0841,
      "mae_dtheta": 0.008802286349236965,
      "mae_dx": 0.0013558813370764256,
      "mae_dy": 0.0012155759613960981,
      "pose_mae_dtheta": 0.06866800785064697,
      "pose_mae_dx": 0.016361257061362267,
      "pose_mae_dy": 0.020783862099051476,
      "pose_rmse_dtheta": 0.23056721687316895,
      "pose_rmse_dx": 0.04266902059316635,
      "pose_rmse_dy": 0.06625417619943619,
      "pose_rmse_mean": 0.11316347122192383,
      "rmse_dtheta": 0.02599300444126129,
      "rmse_dx": 0.004048825707286596,
      "rmse_dy": 0.0031409687362611294,
      "rmse_mean": 0.011060933582484722,
      "rotation_flip": 0.0022062878124415874,
      "sparse_tokens": 32121.0,
      "step": 1879,
      "turn_loss": 0.05025674030184746,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.08734435978442669,
      "grad_norm": 0.5632036328315735,
      "learning_rate": 9.468756456241344e-06,
      "loss": 0.1129,
      "mae_dtheta": 0.022590603679418564,
      "mae_dx": 0.006292177829891443,
      "mae_dy": 0.0038228414487093687,
      "pose_mae_dtheta": 0.16843770444393158,
      "pose_mae_dx": 0.06449772417545319,
      "pose_mae_dy": 0.056550007313489914,
      "pose_rmse_dtheta": 0.27753743529319763,
      "pose_rmse_dx": 0.19193489849567413,
      "pose_rmse_dy": 0.11311953514814377,
      "pose_rmse_mean": 0.19419729709625244,
      "rmse_dtheta": 0.034369051456451416,
      "rmse_dx": 0.018290817737579346,
      "rmse_dy": 0.005994901526719332,
      "rmse_mean": 0.019551590085029602,
      "rotation_flip": 0.007915567606687546,
      "sparse_tokens": 8754.0,
      "step": 1880,
      "turn_loss": 0.20175638794898987,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.08739081955026946,
      "grad_norm": 0.3981795608997345,
      "learning_rate": 9.468163201617063e-06,
      "loss": 0.0858,
      "mae_dtheta": 0.021340029314160347,
      "mae_dx": 0.004070458933711052,
      "mae_dy": 0.004045668989419937,
      "pose_mae_dtheta": 0.15388067066669464,
      "pose_mae_dx": 0.03600314259529114,
      "pose_mae_dy": 0.0610811747610569,
      "pose_rmse_dtheta": 0.27798327803611755,
      "pose_rmse_dx": 0.0877513512969017,
      "pose_rmse_dy": 0.1297740489244461,
      "pose_rmse_mean": 0.16516956686973572,
      "rmse_dtheta": 0.03632437437772751,
      "rmse_dx": 0.011736070737242699,
      "rmse_dy": 0.007377257104963064,
      "rmse_mean": 0.018479235470294952,
      "rotation_flip": 0.005033556837588549,
      "sparse_tokens": 13692.0,
      "step": 1881,
      "turn_loss": 0.164852574467659,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08743727931611224,
      "grad_norm": 0.6575028300285339,
      "learning_rate": 9.46756963453173e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.008810507133603096,
      "mae_dx": 0.0039000005926936865,
      "mae_dy": 0.0015087492065504193,
      "pose_mae_dtheta": 0.06520561128854752,
      "pose_mae_dx": 0.037640418857336044,
      "pose_mae_dy": 0.02433537319302559,
      "pose_rmse_dtheta": 0.14987504482269287,
      "pose_rmse_dx": 0.12421418726444244,
      "pose_rmse_dy": 0.061516888439655304,
      "pose_rmse_mean": 0.11186870187520981,
      "rmse_dtheta": 0.02046346850693226,
      "rmse_dx": 0.012330587022006512,
      "rmse_dy": 0.003198308404535055,
      "rmse_mean": 0.01199745386838913,
      "rotation_flip": 0.003346080193296075,
      "sparse_tokens": 32121.0,
      "step": 1882,
      "turn_loss": 0.07951418310403824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.08748373908195503,
      "grad_norm": 0.5261774063110352,
      "learning_rate": 9.466975755026856e-06,
      "loss": 0.2041,
      "mae_dtheta": 0.037968479096889496,
      "mae_dx": 0.011509913019835949,
      "mae_dy": 0.00283372332341969,
      "pose_mae_dtheta": 0.3438647389411926,
      "pose_mae_dx": 0.08696022629737854,
      "pose_mae_dy": 0.028267866000533104,
      "pose_rmse_dtheta": 0.5808581709861755,
      "pose_rmse_dx": 0.1907494217157364,
      "pose_rmse_dy": 0.058584317564964294,
      "pose_rmse_mean": 0.27673065662384033,
      "rmse_dtheta": 0.05672336369752884,
      "rmse_dx": 0.02304394356906414,
      "rmse_dy": 0.0059801023453474045,
      "rmse_mean": 0.02858247235417366,
      "rotation_flip": 0.008456659503281116,
      "sparse_tokens": 16562.0,
      "step": 1883,
      "turn_loss": 0.25667011737823486,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.08753019884779781,
      "grad_norm": 0.5114459991455078,
      "learning_rate": 9.466381563143967e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.05009143427014351,
      "mae_dx": 0.012540155090391636,
      "mae_dy": 0.01068964321166277,
      "pose_mae_dtheta": 0.41095563769340515,
      "pose_mae_dx": 0.1187656819820404,
      "pose_mae_dy": 0.0945778340101242,
      "pose_rmse_dtheta": 0.6332533955574036,
      "pose_rmse_dx": 0.2531408369541168,
      "pose_rmse_dy": 0.23387394845485687,
      "pose_rmse_mean": 0.3734227418899536,
      "rmse_dtheta": 0.06832745671272278,
      "rmse_dx": 0.024229789152741432,
      "rmse_dy": 0.0234498530626297,
      "rmse_mean": 0.03866903483867645,
      "rotation_flip": 0.0018018018454313278,
      "sparse_tokens": 9605.0,
      "step": 1884,
      "turn_loss": 0.5435804128646851,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.08757665861364058,
      "grad_norm": 0.39640286564826965,
      "learning_rate": 9.46578705892462e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.01617145910859108,
      "mae_dx": 0.00273995753377676,
      "mae_dy": 0.004972129128873348,
      "pose_mae_dtheta": 0.1169615313410759,
      "pose_mae_dx": 0.043064914643764496,
      "pose_mae_dy": 0.05083014443516731,
      "pose_rmse_dtheta": 0.26247960329055786,
      "pose_rmse_dx": 0.09794626384973526,
      "pose_rmse_dy": 0.10673210024833679,
      "pose_rmse_mean": 0.1557193249464035,
      "rmse_dtheta": 0.03142835572361946,
      "rmse_dx": 0.006254611536860466,
      "rmse_dy": 0.009997799061238766,
      "rmse_mean": 0.015893589705228806,
      "rotation_flip": 0.009449881501495838,
      "sparse_tokens": 32073.0,
      "step": 1885,
      "turn_loss": 0.1442699283361435,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.08762311837948336,
      "grad_norm": 0.3801203966140747,
      "learning_rate": 9.465192242410388e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.009101341478526592,
      "mae_dx": 0.0019427298102527857,
      "mae_dy": 0.00251540495082736,
      "pose_mae_dtheta": 0.06388340890407562,
      "pose_mae_dx": 0.024965547025203705,
      "pose_mae_dy": 0.0332445353269577,
      "pose_rmse_dtheta": 0.11949697881937027,
      "pose_rmse_dx": 0.06118189916014671,
      "pose_rmse_dy": 0.06990663707256317,
      "pose_rmse_mean": 0.08352850377559662,
      "rmse_dtheta": 0.01810690201818943,
      "rmse_dx": 0.005771735683083534,
      "rmse_dy": 0.004964281339198351,
      "rmse_mean": 0.009614306502044201,
      "rotation_flip": 0.0060662622563540936,
      "sparse_tokens": 32073.0,
      "step": 1886,
      "turn_loss": 0.08404701948165894,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08766957814532615,
      "grad_norm": 0.5462396740913391,
      "learning_rate": 9.464597113642864e-06,
      "loss": 0.1514,
      "mae_dtheta": 0.015819527208805084,
      "mae_dx": 0.0033838097006082535,
      "mae_dy": 0.003026361111551523,
      "pose_mae_dtheta": 0.11328335106372833,
      "pose_mae_dx": 0.0337204746901989,
      "pose_mae_dy": 0.033299148082733154,
      "pose_rmse_dtheta": 0.29822030663490295,
      "pose_rmse_dx": 0.09214460104703903,
      "pose_rmse_dy": 0.08608482033014297,
      "pose_rmse_mean": 0.15881657600402832,
      "rmse_dtheta": 0.034133851528167725,
      "rmse_dx": 0.01000204123556614,
      "rmse_dy": 0.0078111873008310795,
      "rmse_mean": 0.017315693199634552,
      "rotation_flip": 0.008717309683561325,
      "sparse_tokens": 32121.0,
      "step": 1887,
      "turn_loss": 0.12700283527374268,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.08771603791116893,
      "grad_norm": 0.5562321543693542,
      "learning_rate": 9.464001672663667e-06,
      "loss": 0.1137,
      "mae_dtheta": 0.011568150483071804,
      "mae_dx": 0.0029133842326700687,
      "mae_dy": 0.003374767489731312,
      "pose_mae_dtheta": 0.08665931969881058,
      "pose_mae_dx": 0.02682633325457573,
      "pose_mae_dy": 0.035123806446790695,
      "pose_rmse_dtheta": 0.19883668422698975,
      "pose_rmse_dx": 0.06483422964811325,
      "pose_rmse_dy": 0.08635661751031876,
      "pose_rmse_mean": 0.11667584627866745,
      "rmse_dtheta": 0.025316959246993065,
      "rmse_dx": 0.009550047107040882,
      "rmse_dy": 0.0088121322914958,
      "rmse_mean": 0.014559714123606682,
      "rotation_flip": 0.00873528327792883,
      "sparse_tokens": 32153.0,
      "step": 1888,
      "turn_loss": 0.1229715421795845,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.0877624976770117,
      "grad_norm": 0.5328260660171509,
      "learning_rate": 9.46340591951444e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.007934543304145336,
      "mae_dx": 0.0012293498730286956,
      "mae_dy": 0.0020481112878769636,
      "pose_mae_dtheta": 0.0502321794629097,
      "pose_mae_dx": 0.021176116541028023,
      "pose_mae_dy": 0.02683510258793831,
      "pose_rmse_dtheta": 0.11322320997714996,
      "pose_rmse_dx": 0.04903123527765274,
      "pose_rmse_dy": 0.0552654042840004,
      "pose_rmse_mean": 0.0725066214799881,
      "rmse_dtheta": 0.017592938616871834,
      "rmse_dx": 0.00321644963696599,
      "rmse_dy": 0.004177972674369812,
      "rmse_mean": 0.008329120464622974,
      "rotation_flip": 0.0068288519978523254,
      "sparse_tokens": 32041.0,
      "step": 1889,
      "turn_loss": 0.06633925437927246,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.08780895744285448,
      "grad_norm": 0.37759125232696533,
      "learning_rate": 9.462809854236839e-06,
      "loss": 0.0836,
      "mae_dtheta": 0.008407287299633026,
      "mae_dx": 0.0014867311110720038,
      "mae_dy": 0.001621631789021194,
      "pose_mae_dtheta": 0.061633430421352386,
      "pose_mae_dx": 0.019386794418096542,
      "pose_mae_dy": 0.027416715398430824,
      "pose_rmse_dtheta": 0.17492660880088806,
      "pose_rmse_dx": 0.05701306462287903,
      "pose_rmse_dy": 0.06911090016365051,
      "pose_rmse_mean": 0.10035019367933273,
      "rmse_dtheta": 0.021462611854076385,
      "rmse_dx": 0.005419891327619553,
      "rmse_dy": 0.0037564572412520647,
      "rmse_mean": 0.010212987661361694,
      "rotation_flip": 0.003686150535941124,
      "sparse_tokens": 32057.0,
      "step": 1890,
      "turn_loss": 0.06499876827001572,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.08785541720869727,
      "grad_norm": 0.5941780209541321,
      "learning_rate": 9.46221347687255e-06,
      "loss": 0.1409,
      "mae_dtheta": 0.04559694975614548,
      "mae_dx": 0.013941335491836071,
      "mae_dy": 0.007255383301526308,
      "pose_mae_dtheta": 0.355457067489624,
      "pose_mae_dx": 0.11894220858812332,
      "pose_mae_dy": 0.09770079702138901,
      "pose_rmse_dtheta": 0.6265152096748352,
      "pose_rmse_dx": 0.2220260053873062,
      "pose_rmse_dy": 0.2160121500492096,
      "pose_rmse_mean": 0.3548511266708374,
      "rmse_dtheta": 0.06501743942499161,
      "rmse_dx": 0.025358490645885468,
      "rmse_dy": 0.012807747349143028,
      "rmse_mean": 0.03439456224441528,
      "rotation_flip": 0.005934718064963818,
      "sparse_tokens": 5724.0,
      "step": 1891,
      "turn_loss": 0.33685803413391113,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.08790187697454005,
      "grad_norm": 0.5953270196914673,
      "learning_rate": 9.461616787463278e-06,
      "loss": 0.1326,
      "mae_dtheta": 0.03977426514029503,
      "mae_dx": 0.010621822439134121,
      "mae_dy": 0.00602027727290988,
      "pose_mae_dtheta": 0.31886744499206543,
      "pose_mae_dx": 0.09015371650457382,
      "pose_mae_dy": 0.07929965108633041,
      "pose_rmse_dtheta": 0.5801144242286682,
      "pose_rmse_dx": 0.20247727632522583,
      "pose_rmse_dy": 0.2022228240966797,
      "pose_rmse_mean": 0.3282715082168579,
      "rmse_dtheta": 0.060050204396247864,
      "rmse_dx": 0.02214725874364376,
      "rmse_dy": 0.014513911679387093,
      "rmse_mean": 0.03223712742328644,
      "rotation_flip": 0.009756097570061684,
      "sparse_tokens": 18869.0,
      "step": 1892,
      "turn_loss": 0.2633383572101593,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08794833674038283,
      "grad_norm": 0.4326825439929962,
      "learning_rate": 9.46101978605075e-06,
      "loss": 0.1073,
      "mae_dtheta": 0.010428558103740215,
      "mae_dx": 0.0014788027619943023,
      "mae_dy": 0.0020817893091589212,
      "pose_mae_dtheta": 0.07359551638364792,
      "pose_mae_dx": 0.019524110481142998,
      "pose_mae_dy": 0.028968529775738716,
      "pose_rmse_dtheta": 0.17868153750896454,
      "pose_rmse_dx": 0.052008096128702164,
      "pose_rmse_dy": 0.06628560274839401,
      "pose_rmse_mean": 0.0989917442202568,
      "rmse_dtheta": 0.023064186796545982,
      "rmse_dx": 0.004335356876254082,
      "rmse_dy": 0.004503367468714714,
      "rmse_mean": 0.010634303092956543,
      "rotation_flip": 0.004375497344881296,
      "sparse_tokens": 32121.0,
      "step": 1893,
      "turn_loss": 0.07120011001825333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0879947965062256,
      "grad_norm": 0.5184606909751892,
      "learning_rate": 9.460422472676713e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.015475873835384846,
      "mae_dx": 0.003573845373466611,
      "mae_dy": 0.005169514566659927,
      "pose_mae_dtheta": 0.11022479087114334,
      "pose_mae_dx": 0.049799587577581406,
      "pose_mae_dy": 0.04809078946709633,
      "pose_rmse_dtheta": 0.23066233098506927,
      "pose_rmse_dx": 0.11721330136060715,
      "pose_rmse_dy": 0.09617099165916443,
      "pose_rmse_mean": 0.14801554381847382,
      "rmse_dtheta": 0.028527356684207916,
      "rmse_dx": 0.008794083259999752,
      "rmse_dy": 0.010383379645645618,
      "rmse_mean": 0.015901606529951096,
      "rotation_flip": 0.005177770275622606,
      "sparse_tokens": 32089.0,
      "step": 1894,
      "turn_loss": 0.14676640927791595,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.0880412562720684,
      "grad_norm": 0.5043277144432068,
      "learning_rate": 9.459824847382937e-06,
      "loss": 0.1322,
      "mae_dtheta": 0.04529855027794838,
      "mae_dx": 0.012463008053600788,
      "mae_dy": 0.0036616413854062557,
      "pose_mae_dtheta": 0.38471728563308716,
      "pose_mae_dx": 0.09523286670446396,
      "pose_mae_dy": 0.04765390232205391,
      "pose_rmse_dtheta": 0.6679006218910217,
      "pose_rmse_dx": 0.23897023499011993,
      "pose_rmse_dy": 0.09221921861171722,
      "pose_rmse_mean": 0.3330300450325012,
      "rmse_dtheta": 0.06366034597158432,
      "rmse_dx": 0.02504887804389,
      "rmse_dy": 0.007007247302681208,
      "rmse_mean": 0.03190549090504646,
      "rotation_flip": 0.014705882407724857,
      "sparse_tokens": 8900.0,
      "step": 1895,
      "turn_loss": 0.2766987681388855,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.08808771603791117,
      "grad_norm": 0.6871022582054138,
      "learning_rate": 9.459226910211219e-06,
      "loss": 0.1953,
      "mae_dtheta": 0.03402986004948616,
      "mae_dx": 0.011271492578089237,
      "mae_dy": 0.006130707450211048,
      "pose_mae_dtheta": 0.2576717138290405,
      "pose_mae_dx": 0.09128538519144058,
      "pose_mae_dy": 0.08172811567783356,
      "pose_rmse_dtheta": 0.45666414499282837,
      "pose_rmse_dx": 0.19110094010829926,
      "pose_rmse_dy": 0.19747409224510193,
      "pose_rmse_mean": 0.28174638748168945,
      "rmse_dtheta": 0.05204633250832558,
      "rmse_dx": 0.022548798471689224,
      "rmse_dy": 0.012780080549418926,
      "rmse_mean": 0.029125070199370384,
      "rotation_flip": 0.003722084453329444,
      "sparse_tokens": 14387.0,
      "step": 1896,
      "turn_loss": 0.27193281054496765,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08813417580375395,
      "grad_norm": 0.4876483678817749,
      "learning_rate": 9.458628661203368e-06,
      "loss": 0.1281,
      "mae_dtheta": 0.011850452981889248,
      "mae_dx": 0.002038337290287018,
      "mae_dy": 0.002346342895179987,
      "pose_mae_dtheta": 0.07612995058298111,
      "pose_mae_dx": 0.024766739457845688,
      "pose_mae_dy": 0.030295660719275475,
      "pose_rmse_dtheta": 0.16415256261825562,
      "pose_rmse_dx": 0.06454168260097504,
      "pose_rmse_dy": 0.07584747672080994,
      "pose_rmse_mean": 0.10151390731334686,
      "rmse_dtheta": 0.023582102730870247,
      "rmse_dx": 0.006513890344649553,
      "rmse_dy": 0.0051801446825265884,
      "rmse_mean": 0.01175871305167675,
      "rotation_flip": 0.004137930925935507,
      "sparse_tokens": 32121.0,
      "step": 1897,
      "turn_loss": 0.09876235574483871,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.08818063556959672,
      "grad_norm": 0.47628921270370483,
      "learning_rate": 9.458030100401221e-06,
      "loss": 0.1473,
      "mae_dtheta": 0.034757666289806366,
      "mae_dx": 0.009858900681138039,
      "mae_dy": 0.0026322787161916494,
      "pose_mae_dtheta": 0.30116817355155945,
      "pose_mae_dx": 0.06785561889410019,
      "pose_mae_dy": 0.03049885854125023,
      "pose_rmse_dtheta": 0.5824618339538574,
      "pose_rmse_dx": 0.20427632331848145,
      "pose_rmse_dy": 0.11018169671297073,
      "pose_rmse_mean": 0.29897329211235046,
      "rmse_dtheta": 0.05716572701931,
      "rmse_dx": 0.02293488197028637,
      "rmse_dy": 0.006382043473422527,
      "rmse_mean": 0.028827551752328873,
      "rotation_flip": 0.010810811072587967,
      "sparse_tokens": 7023.0,
      "step": 1898,
      "turn_loss": 0.20441564917564392,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.08822709533543951,
      "grad_norm": 0.5905783176422119,
      "learning_rate": 9.457431227846637e-06,
      "loss": 0.1094,
      "mae_dtheta": 0.0076988921500742435,
      "mae_dx": 0.0015238741179928184,
      "mae_dy": 0.0014225027989596128,
      "pose_mae_dtheta": 0.053835365921258926,
      "pose_mae_dx": 0.017681630328297615,
      "pose_mae_dy": 0.02054421976208687,
      "pose_rmse_dtheta": 0.15800593793392181,
      "pose_rmse_dx": 0.051779769361019135,
      "pose_rmse_dy": 0.055028535425662994,
      "pose_rmse_mean": 0.08827140927314758,
      "rmse_dtheta": 0.01910838671028614,
      "rmse_dx": 0.005228942260146141,
      "rmse_dy": 0.0029557894449681044,
      "rmse_mean": 0.009097706526517868,
      "rotation_flip": 0.002621919149532914,
      "sparse_tokens": 32057.0,
      "step": 1899,
      "turn_loss": 0.05707961320877075,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.08827355510128229,
      "grad_norm": 0.5075445175170898,
      "learning_rate": 9.456832043581495e-06,
      "loss": 0.1102,
      "mae_dtheta": 0.01123950444161892,
      "mae_dx": 0.0014558543916791677,
      "mae_dy": 0.0020822854712605476,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5075445771217346,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 143.34292602539062,
      "model/head/act_norm_mean": 112.84280303030303,
      "model/head/act_norm_min": 71.52246856689453,
      "model/head/act_over_embed": 77.54663069339087,
      "model/head/grad_frac": 0.09110511094331741,
      "model/head/grad_norm": 0.046239905059337616,
      "model/head/grad_zero_frac": 0.00021479299175553024,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6892558396464646,
      "model/head/update_ratio": 0.0008024455164559186,
      "model/head/weight_delta": 4.971112251281738,
      "model/head/weight_delta_rel": 0.08720803260803223,
      "model/head/weight_norm": 57.62373352050781,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4140489399433136,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4139851796787416,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41391974687576294,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28449449126554743,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09729426354169846,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04938117414712906,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5440022421524664,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016058192122727633,
      "model/modality_embedder.encoders.pose/weight_delta": 1.6141645908355713,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.052739787846803665,
      "model/modality_embedder.encoders.pose/weight_norm": 30.75139045715332,
      "model/modality_embedder/grad_frac": 0.09729426354169846,
      "model/modality_embedder/grad_norm": 0.04938117414712906,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5440022421524664,
      "model/modality_embedder/update_ratio": 0.0016058192122727633,
      "model/modality_embedder/weight_delta": 1.6141645908355713,
      "model/modality_embedder/weight_delta_rel": 0.052739787846803665,
      "model/modality_embedder/weight_norm": 30.75139045715332,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.36326599121094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.710507856341188,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.944191932678223,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.294082980149586,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06677719205617905,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.033892400562763214,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012282582465559244,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.9649097919464111,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03516189381480217,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.5938720703125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 82.79048919677734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.81607744107744,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.12918758392334,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.053840749285868,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06502826511859894,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03300474211573601,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001132323406636715,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.1977262496948242,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04149017482995987,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.147804260253906,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.40074920654297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.750423380631712,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.552845001220703,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.38314138857957,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07085428386926651,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.035961706191301346,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011955976951867342,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.2739367485046387,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04277640953660011,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.078433990478516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.89895629882812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.587253988295654,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.324721336364746,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.64542857884532,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08423136919736862,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04275117442011833,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014503364218398929,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.0883888006210327,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03719596564769745,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.476728439331055,
      "model/normalizer/grad_frac": 0.3264634907245636,
      "model/normalizer/grad_norm": 0.16569477319717407,
      "model/normalizer/grad_zero_frac": 0.00015362599515356123,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002125493250787258,
      "model/normalizer/weight_delta": 2.3295273780822754,
      "model/normalizer/weight_delta_rel": 0.030002964660525322,
      "model/normalizer/weight_norm": 77.95591735839844,
      "pose_mae_dtheta": 0.08187925070524216,
      "pose_mae_dx": 0.019726872444152832,
      "pose_mae_dy": 0.029073169454932213,
      "pose_rmse_dtheta": 0.22531872987747192,
      "pose_rmse_dx": 0.05312611907720566,
      "pose_rmse_dy": 0.06955886632204056,
      "pose_rmse_mean": 0.11600124090909958,
      "rmse_dtheta": 0.025237783789634705,
      "rmse_dx": 0.004376083612442017,
      "rmse_dy": 0.004417124669998884,
      "rmse_mean": 0.011343664489686489,
      "rotation_flip": 0.003180914558470249,
      "sparse_tokens": 32105.0,
      "step": 1900,
      "turn_loss": 0.0800248384475708,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34930.0,
      "epoch": 0.08832001486712507,
      "grad_norm": 1.6481575965881348,
      "learning_rate": 9.456232547647695e-06,
      "loss": 0.3177,
      "mae_dtheta": 0.04501034691929817,
      "mae_dx": 0.014953302219510078,
      "mae_dy": 0.006056306418031454,
      "pose_mae_dtheta": 0.3751124143600464,
      "pose_mae_dx": 0.12363965064287186,
      "pose_mae_dy": 0.06357575207948685,
      "pose_rmse_dtheta": 0.6176223158836365,
      "pose_rmse_dx": 0.24193061888217926,
      "pose_rmse_dy": 0.14851318299770355,
      "pose_rmse_mean": 0.3360220193862915,
      "rmse_dtheta": 0.06369677186012268,
      "rmse_dx": 0.026432136073708534,
      "rmse_dy": 0.012643859721720219,
      "rmse_mean": 0.034257590770721436,
      "rotation_flip": 0.016910934820771217,
      "sparse_tokens": 25905.0,
      "step": 1901,
      "turn_loss": 0.32130083441734314,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08836647463296785,
      "grad_norm": 0.5596120357513428,
      "learning_rate": 9.455632740087161e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.01606612838804722,
      "mae_dx": 0.004311437252908945,
      "mae_dy": 0.005009412299841642,
      "pose_mae_dtheta": 0.11673402786254883,
      "pose_mae_dx": 0.04794241860508919,
      "pose_mae_dy": 0.05579391494393349,
      "pose_rmse_dtheta": 0.27492013573646545,
      "pose_rmse_dx": 0.11782217025756836,
      "pose_rmse_dy": 0.1326451301574707,
      "pose_rmse_mean": 0.17512914538383484,
      "rmse_dtheta": 0.031625326722860336,
      "rmse_dx": 0.011520487256348133,
      "rmse_dy": 0.011107313446700573,
      "rmse_mean": 0.01808437705039978,
      "rotation_flip": 0.00532670458778739,
      "sparse_tokens": 32089.0,
      "step": 1902,
      "turn_loss": 0.14367736876010895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08841293439881064,
      "grad_norm": 0.6519396305084229,
      "learning_rate": 9.45503262094184e-06,
      "loss": 0.1842,
      "mae_dtheta": 0.009313107468187809,
      "mae_dx": 0.0012086759088560939,
      "mae_dy": 0.002126329578459263,
      "pose_mae_dtheta": 0.05904350057244301,
      "pose_mae_dx": 0.02005370892584324,
      "pose_mae_dy": 0.03115062415599823,
      "pose_rmse_dtheta": 0.10893227159976959,
      "pose_rmse_dx": 0.04524347558617592,
      "pose_rmse_dy": 0.06958852708339691,
      "pose_rmse_mean": 0.07458809018135071,
      "rmse_dtheta": 0.017092116177082062,
      "rmse_dx": 0.0035288678482174873,
      "rmse_dy": 0.004049014300107956,
      "rmse_mean": 0.008223332464694977,
      "rotation_flip": 0.0038834952283650637,
      "sparse_tokens": 32089.0,
      "step": 1903,
      "turn_loss": 0.08443430811166763,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.08845939416465341,
      "grad_norm": 0.5155231356620789,
      "learning_rate": 9.454432190253695e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.03319134935736656,
      "mae_dx": 0.007224175613373518,
      "mae_dy": 0.0027928315103054047,
      "pose_mae_dtheta": 0.2913323938846588,
      "pose_mae_dx": 0.0589635856449604,
      "pose_mae_dy": 0.0261636134237051,
      "pose_rmse_dtheta": 0.6105247735977173,
      "pose_rmse_dx": 0.12835858762264252,
      "pose_rmse_dy": 0.06992600113153458,
      "pose_rmse_mean": 0.2696031332015991,
      "rmse_dtheta": 0.056638821959495544,
      "rmse_dx": 0.015781143680214882,
      "rmse_dy": 0.0047574774362146854,
      "rmse_mean": 0.025725815445184708,
      "rotation_flip": 0.004889975767582655,
      "sparse_tokens": 7058.0,
      "step": 1904,
      "turn_loss": 0.15170781314373016,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.08850585393049619,
      "grad_norm": 0.6501340270042419,
      "learning_rate": 9.453831448064717e-06,
      "loss": 0.1659,
      "mae_dtheta": 0.024603914469480515,
      "mae_dx": 0.006763639859855175,
      "mae_dy": 0.0040125115774571896,
      "pose_mae_dtheta": 0.17749947309494019,
      "pose_mae_dx": 0.07068544626235962,
      "pose_mae_dy": 0.04364927113056183,
      "pose_rmse_dtheta": 0.31237494945526123,
      "pose_rmse_dx": 0.1674094945192337,
      "pose_rmse_dy": 0.09512809664011002,
      "pose_rmse_mean": 0.19163751602172852,
      "rmse_dtheta": 0.03920185565948486,
      "rmse_dx": 0.015643702819943428,
      "rmse_dy": 0.008214927278459072,
      "rmse_mean": 0.021020162850618362,
      "rotation_flip": 0.0,
      "sparse_tokens": 7263.0,
      "step": 1905,
      "turn_loss": 0.21811743080615997,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.08855231369633897,
      "grad_norm": 0.5586879849433899,
      "learning_rate": 9.453230394416914e-06,
      "loss": 0.0777,
      "mae_dtheta": 0.011445203796029091,
      "mae_dx": 0.002189089311286807,
      "mae_dy": 0.0030914898961782455,
      "pose_mae_dtheta": 0.07733863592147827,
      "pose_mae_dx": 0.031291764229536057,
      "pose_mae_dy": 0.03639603778719902,
      "pose_rmse_dtheta": 0.17610616981983185,
      "pose_rmse_dx": 0.0871734768152237,
      "pose_rmse_dy": 0.10529324412345886,
      "pose_rmse_mean": 0.12285763025283813,
      "rmse_dtheta": 0.022873638197779655,
      "rmse_dx": 0.0059189097955822945,
      "rmse_dy": 0.008079033344984055,
      "rmse_mean": 0.012290528044104576,
      "rotation_flip": 0.00322971330024302,
      "sparse_tokens": 32105.0,
      "step": 1906,
      "turn_loss": 0.09666068851947784,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.08859877346218176,
      "grad_norm": 0.608282208442688,
      "learning_rate": 9.452629029352322e-06,
      "loss": 0.1653,
      "mae_dtheta": 0.008459481410682201,
      "mae_dx": 0.0017446947749704123,
      "mae_dy": 0.002577943494543433,
      "pose_mae_dtheta": 0.059133920818567276,
      "pose_mae_dx": 0.026685064658522606,
      "pose_mae_dy": 0.02698819525539875,
      "pose_rmse_dtheta": 0.14213399589061737,
      "pose_rmse_dx": 0.07298917323350906,
      "pose_rmse_dy": 0.07900065928697586,
      "pose_rmse_mean": 0.09804128110408783,
      "rmse_dtheta": 0.018216127529740334,
      "rmse_dx": 0.004602284636348486,
      "rmse_dy": 0.00640527019277215,
      "rmse_mean": 0.009741228073835373,
      "rotation_flip": 0.0038955979980528355,
      "sparse_tokens": 32105.0,
      "step": 1907,
      "turn_loss": 0.06804399937391281,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.08864523322802453,
      "grad_norm": 0.37860676646232605,
      "learning_rate": 9.45202735291299e-06,
      "loss": 0.1216,
      "mae_dtheta": 0.0080213388428092,
      "mae_dx": 0.001687988406047225,
      "mae_dy": 0.0014923496637493372,
      "pose_mae_dtheta": 0.05574985221028328,
      "pose_mae_dx": 0.017707720398902893,
      "pose_mae_dy": 0.020464837551116943,
      "pose_rmse_dtheta": 0.14001113176345825,
      "pose_rmse_dx": 0.041702840477228165,
      "pose_rmse_dy": 0.05201130360364914,
      "pose_rmse_mean": 0.07790842652320862,
      "rmse_dtheta": 0.018873248249292374,
      "rmse_dx": 0.004962499253451824,
      "rmse_dy": 0.0032634662929922342,
      "rmse_mean": 0.00903307180851698,
      "rotation_flip": 0.002506265649572015,
      "sparse_tokens": 32153.0,
      "step": 1908,
      "turn_loss": 0.06847953796386719,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.08869169299386731,
      "grad_norm": 0.5763629674911499,
      "learning_rate": 9.451425365140997e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.02910374477505684,
      "mae_dx": 0.011415256187319756,
      "mae_dy": 0.006666690111160278,
      "pose_mae_dtheta": 0.24206814169883728,
      "pose_mae_dx": 0.10092104971408844,
      "pose_mae_dy": 0.10829420387744904,
      "pose_rmse_dtheta": 0.41981470584869385,
      "pose_rmse_dx": 0.22775331139564514,
      "pose_rmse_dy": 0.2350815087556839,
      "pose_rmse_mean": 0.294216513633728,
      "rmse_dtheta": 0.0463407039642334,
      "rmse_dx": 0.025093434378504753,
      "rmse_dy": 0.012204393744468689,
      "rmse_mean": 0.027879511937499046,
      "rotation_flip": 0.007585335057228804,
      "sparse_tokens": 14281.0,
      "step": 1909,
      "turn_loss": 0.23566754162311554,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08873815275971009,
      "grad_norm": 0.6054937243461609,
      "learning_rate": 9.450823066078437e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.007935171015560627,
      "mae_dx": 0.0015135187422856688,
      "mae_dy": 0.0011542290449142456,
      "pose_mae_dtheta": 0.06089027598500252,
      "pose_mae_dx": 0.014606560580432415,
      "pose_mae_dy": 0.02017555944621563,
      "pose_rmse_dtheta": 0.16146942973136902,
      "pose_rmse_dx": 0.04390507936477661,
      "pose_rmse_dy": 0.04874454438686371,
      "pose_rmse_mean": 0.08470635116100311,
      "rmse_dtheta": 0.0203439611941576,
      "rmse_dx": 0.005048198625445366,
      "rmse_dy": 0.002318481681868434,
      "rmse_mean": 0.009236880578100681,
      "rotation_flip": 0.003892943961545825,
      "sparse_tokens": 32121.0,
      "step": 1910,
      "turn_loss": 0.05017998069524765,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.08878461252555288,
      "grad_norm": 0.3911988437175751,
      "learning_rate": 9.450220455767432e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.03743775933980942,
      "mae_dx": 0.013046390376985073,
      "mae_dy": 0.004090795759111643,
      "pose_mae_dtheta": 0.2679215371608734,
      "pose_mae_dx": 0.09338852763175964,
      "pose_mae_dy": 0.05585026368498802,
      "pose_rmse_dtheta": 0.4322621524333954,
      "pose_rmse_dx": 0.1990528553724289,
      "pose_rmse_dy": 0.12369823455810547,
      "pose_rmse_mean": 0.25167107582092285,
      "rmse_dtheta": 0.052982162684202194,
      "rmse_dx": 0.02464185655117035,
      "rmse_dy": 0.008070934563875198,
      "rmse_mean": 0.02856498584151268,
      "rotation_flip": 0.014605647884309292,
      "sparse_tokens": 16569.0,
      "step": 1911,
      "turn_loss": 0.28109243512153625,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.08883107229139565,
      "grad_norm": 0.4950794577598572,
      "learning_rate": 9.449617534250122e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.0053620487451553345,
      "mae_dx": 0.0012154777068644762,
      "mae_dy": 0.0006104004569351673,
      "pose_mae_dtheta": 0.038877781480550766,
      "pose_mae_dx": 0.011008206754922867,
      "pose_mae_dy": 0.010533441789448261,
      "pose_rmse_dtheta": 0.12621624767780304,
      "pose_rmse_dx": 0.02578136883676052,
      "pose_rmse_dy": 0.03228304535150528,
      "pose_rmse_mean": 0.06142688915133476,
      "rmse_dtheta": 0.017855409532785416,
      "rmse_dx": 0.0036399324890226126,
      "rmse_dy": 0.0013553941389545798,
      "rmse_mean": 0.007616912480443716,
      "rotation_flip": 0.0021505376789718866,
      "sparse_tokens": 32153.0,
      "step": 1912,
      "turn_loss": 0.03746027499437332,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.08887753205723843,
      "grad_norm": 0.9757896661758423,
      "learning_rate": 9.449014301568671e-06,
      "loss": 0.2618,
      "mae_dtheta": 0.030012233182787895,
      "mae_dx": 0.010660406202077866,
      "mae_dy": 0.005553273484110832,
      "pose_mae_dtheta": 0.2156892567873001,
      "pose_mae_dx": 0.09208301454782486,
      "pose_mae_dy": 0.06236744299530983,
      "pose_rmse_dtheta": 0.38127970695495605,
      "pose_rmse_dx": 0.22034960985183716,
      "pose_rmse_dy": 0.14004389941692352,
      "pose_rmse_mean": 0.24722442030906677,
      "rmse_dtheta": 0.04625400900840759,
      "rmse_dx": 0.022865764796733856,
      "rmse_dy": 0.01104703638702631,
      "rmse_mean": 0.026722270995378494,
      "rotation_flip": 0.015068492852151394,
      "sparse_tokens": 23362.0,
      "step": 1913,
      "turn_loss": 0.2527369260787964,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.08892399182308121,
      "grad_norm": 0.49399322271347046,
      "learning_rate": 9.44841075776526e-06,
      "loss": 0.1469,
      "mae_dtheta": 0.009335464797914028,
      "mae_dx": 0.0022427067160606384,
      "mae_dy": 0.0015238121850416064,
      "pose_mae_dtheta": 0.0720326155424118,
      "pose_mae_dx": 0.022279847413301468,
      "pose_mae_dy": 0.020624514669179916,
      "pose_rmse_dtheta": 0.20186807215213776,
      "pose_rmse_dx": 0.048529002815485,
      "pose_rmse_dy": 0.06420458853244781,
      "pose_rmse_mean": 0.10486721992492676,
      "rmse_dtheta": 0.023815322667360306,
      "rmse_dx": 0.005833091679960489,
      "rmse_dy": 0.0034508511889725924,
      "rmse_mean": 0.011033087968826294,
      "rotation_flip": 0.007240546867251396,
      "sparse_tokens": 32217.0,
      "step": 1914,
      "turn_loss": 0.08141715824604034,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64148.0,
      "epoch": 0.08897045158892398,
      "grad_norm": 0.36936119198799133,
      "learning_rate": 9.447806902882098e-06,
      "loss": 0.0995,
      "mae_dtheta": 0.008686520159244537,
      "mae_dx": 0.0018013312947005033,
      "mae_dy": 0.0022812173701822758,
      "pose_mae_dtheta": 0.06345926970243454,
      "pose_mae_dx": 0.02144889160990715,
      "pose_mae_dy": 0.029046164825558662,
      "pose_rmse_dtheta": 0.13532443344593048,
      "pose_rmse_dx": 0.06899937242269516,
      "pose_rmse_dy": 0.07224976271390915,
      "pose_rmse_mean": 0.0921911895275116,
      "rmse_dtheta": 0.018273241817951202,
      "rmse_dx": 0.006142147816717625,
      "rmse_dy": 0.005033045541495085,
      "rmse_mean": 0.009816145524382591,
      "rotation_flip": 0.005489864852279425,
      "sparse_tokens": 32048.0,
      "step": 1915,
      "turn_loss": 0.07685898244380951,
      "turns": 197.0,
      "turns_per_sample": 197.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.08901691135476678,
      "grad_norm": 0.49243929982185364,
      "learning_rate": 9.447202736961411e-06,
      "loss": 0.138,
      "mae_dtheta": 0.034030042588710785,
      "mae_dx": 0.015781613066792488,
      "mae_dy": 0.006551973521709442,
      "pose_mae_dtheta": 0.2410965859889984,
      "pose_mae_dx": 0.11824405938386917,
      "pose_mae_dy": 0.1029253825545311,
      "pose_rmse_dtheta": 0.40067288279533386,
      "pose_rmse_dx": 0.24753549695014954,
      "pose_rmse_dy": 0.2056160271167755,
      "pose_rmse_mean": 0.2846081256866455,
      "rmse_dtheta": 0.04810861125588417,
      "rmse_dx": 0.029525017365813255,
      "rmse_dy": 0.011646945960819721,
      "rmse_mean": 0.029760193079710007,
      "rotation_flip": 0.019736841320991516,
      "sparse_tokens": 13892.0,
      "step": 1916,
      "turn_loss": 0.2876420021057129,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.08906337112060955,
      "grad_norm": 0.5538560152053833,
      "learning_rate": 9.44659826004545e-06,
      "loss": 0.1504,
      "mae_dtheta": 0.04009047523140907,
      "mae_dx": 0.01116073690354824,
      "mae_dy": 0.006650393828749657,
      "pose_mae_dtheta": 0.3402099609375,
      "pose_mae_dx": 0.10040153563022614,
      "pose_mae_dy": 0.05696960538625717,
      "pose_rmse_dtheta": 0.5670815706253052,
      "pose_rmse_dx": 0.20137308537960052,
      "pose_rmse_dy": 0.1542128473520279,
      "pose_rmse_mean": 0.3075558543205261,
      "rmse_dtheta": 0.05963830277323723,
      "rmse_dx": 0.021576520055532455,
      "rmse_dy": 0.01619853265583515,
      "rmse_mean": 0.03247112035751343,
      "rotation_flip": 0.013345195911824703,
      "sparse_tokens": 17642.0,
      "step": 1917,
      "turn_loss": 0.3594454526901245,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 29847.0,
      "epoch": 0.08910983088645233,
      "grad_norm": 0.8020291924476624,
      "learning_rate": 9.445993472176487e-06,
      "loss": 0.1864,
      "mae_dtheta": 0.025025323033332825,
      "mae_dx": 0.01030826661735773,
      "mae_dy": 0.005225419532507658,
      "pose_mae_dtheta": 0.2053336501121521,
      "pose_mae_dx": 0.08722463250160217,
      "pose_mae_dy": 0.07180999964475632,
      "pose_rmse_dtheta": 0.3886404037475586,
      "pose_rmse_dx": 0.21795128285884857,
      "pose_rmse_dy": 0.16395312547683716,
      "pose_rmse_mean": 0.2568482756614685,
      "rmse_dtheta": 0.03993092104792595,
      "rmse_dx": 0.023908955976366997,
      "rmse_dy": 0.009222912602126598,
      "rmse_mean": 0.02435426227748394,
      "rotation_flip": 0.009938837960362434,
      "sparse_tokens": 24067.0,
      "step": 1918,
      "turn_loss": 0.22184018790721893,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.0891562906522951,
      "grad_norm": 0.4193367063999176,
      "learning_rate": 9.445388373396814e-06,
      "loss": 0.0994,
      "mae_dtheta": 0.010563800111413002,
      "mae_dx": 0.002326731802895665,
      "mae_dy": 0.0026934174820780754,
      "pose_mae_dtheta": 0.06976359337568283,
      "pose_mae_dx": 0.028715230524539948,
      "pose_mae_dy": 0.029964223504066467,
      "pose_rmse_dtheta": 0.13836131989955902,
      "pose_rmse_dx": 0.062026266008615494,
      "pose_rmse_dy": 0.06731680035591125,
      "pose_rmse_mean": 0.08923479169607162,
      "rmse_dtheta": 0.019443033263087273,
      "rmse_dx": 0.0062497686594724655,
      "rmse_dy": 0.005581693258136511,
      "rmse_mean": 0.010424831882119179,
      "rotation_flip": 0.0074217491783201694,
      "sparse_tokens": 32185.0,
      "step": 1919,
      "turn_loss": 0.08857915550470352,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.0892027504181379,
      "grad_norm": 0.6302992105484009,
      "learning_rate": 9.444782963748745e-06,
      "loss": 0.1113,
      "mae_dtheta": 0.011272106319665909,
      "mae_dx": 0.0023546621669083834,
      "mae_dy": 0.003349152859300375,
      "pose_mae_dtheta": 0.07760363817214966,
      "pose_mae_dx": 0.033137910068035126,
      "pose_mae_dy": 0.036703839898109436,
      "pose_rmse_dtheta": 0.15971659123897552,
      "pose_rmse_dx": 0.07781311869621277,
      "pose_rmse_dy": 0.09133949130773544,
      "pose_rmse_mean": 0.10962306708097458,
      "rmse_dtheta": 0.023459436371922493,
      "rmse_dx": 0.005773307289928198,
      "rmse_dy": 0.007131531368941069,
      "rmse_mean": 0.012121425941586494,
      "rotation_flip": 0.008342401124536991,
      "sparse_tokens": 32185.0,
      "step": 1920,
      "turn_loss": 0.11098412424325943,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13928.0,
      "epoch": 0.08924921018398067,
      "grad_norm": 0.5823469161987305,
      "learning_rate": 9.444177243274619e-06,
      "loss": 0.1763,
      "mae_dtheta": 0.0345754474401474,
      "mae_dx": 0.012224226258695126,
      "mae_dy": 0.005275119561702013,
      "pose_mae_dtheta": 0.29244256019592285,
      "pose_mae_dx": 0.09926820546388626,
      "pose_mae_dy": 0.051811333745718,
      "pose_rmse_dtheta": 0.4537467360496521,
      "pose_rmse_dx": 0.2196274697780609,
      "pose_rmse_dy": 0.11496029049158096,
      "pose_rmse_mean": 0.2627781629562378,
      "rmse_dtheta": 0.04971301183104515,
      "rmse_dx": 0.024343540892004967,
      "rmse_dy": 0.010185055434703827,
      "rmse_mean": 0.028080536052584648,
      "rotation_flip": 0.025276461616158485,
      "sparse_tokens": 10588.0,
      "step": 1921,
      "turn_loss": 0.29109475016593933,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08929566994982345,
      "grad_norm": 0.5350749492645264,
      "learning_rate": 9.443571212016791e-06,
      "loss": 0.1177,
      "mae_dtheta": 0.01404516026377678,
      "mae_dx": 0.0017015637131407857,
      "mae_dy": 0.002367136301472783,
      "pose_mae_dtheta": 0.10300470143556595,
      "pose_mae_dx": 0.024060459807515144,
      "pose_mae_dy": 0.0293270330876112,
      "pose_rmse_dtheta": 0.2897249460220337,
      "pose_rmse_dx": 0.05658559873700142,
      "pose_rmse_dy": 0.06900157034397125,
      "pose_rmse_mean": 0.13843737542629242,
      "rmse_dtheta": 0.03229841589927673,
      "rmse_dx": 0.0048054540529847145,
      "rmse_dy": 0.005034401547163725,
      "rmse_mean": 0.01404609065502882,
      "rotation_flip": 0.006637168116867542,
      "sparse_tokens": 32121.0,
      "step": 1922,
      "turn_loss": 0.09166336059570312,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.08934212971566623,
      "grad_norm": 0.7113227248191833,
      "learning_rate": 9.442964870017646e-06,
      "loss": 0.0846,
      "mae_dtheta": 0.01400760468095541,
      "mae_dx": 0.0024285507388412952,
      "mae_dy": 0.0033326551783829927,
      "pose_mae_dtheta": 0.09892614185810089,
      "pose_mae_dx": 0.031176796182990074,
      "pose_mae_dy": 0.03854093700647354,
      "pose_rmse_dtheta": 0.22623039782047272,
      "pose_rmse_dx": 0.08003270626068115,
      "pose_rmse_dy": 0.08461330831050873,
      "pose_rmse_mean": 0.130292147397995,
      "rmse_dtheta": 0.028112072497606277,
      "rmse_dx": 0.0073443311266601086,
      "rmse_dy": 0.00753871351480484,
      "rmse_mean": 0.014331705868244171,
      "rotation_flip": 0.008457510732114315,
      "sparse_tokens": 32057.0,
      "step": 1923,
      "turn_loss": 0.11339983344078064,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17211.0,
      "epoch": 0.08938858948150902,
      "grad_norm": 0.5481043457984924,
      "learning_rate": 9.44235821731958e-06,
      "loss": 0.1612,
      "mae_dtheta": 0.03154410794377327,
      "mae_dx": 0.007643716875463724,
      "mae_dy": 0.005508681293576956,
      "pose_mae_dtheta": 0.2397996336221695,
      "pose_mae_dx": 0.0482596755027771,
      "pose_mae_dy": 0.07273215800523758,
      "pose_rmse_dtheta": 0.4554065763950348,
      "pose_rmse_dx": 0.1125616580247879,
      "pose_rmse_dy": 0.18265260756015778,
      "pose_rmse_mean": 0.25020694732666016,
      "rmse_dtheta": 0.051559220999479294,
      "rmse_dx": 0.01746019907295704,
      "rmse_dy": 0.011367770843207836,
      "rmse_mean": 0.026795729994773865,
      "rotation_flip": 0.023076923564076424,
      "sparse_tokens": 13854.0,
      "step": 1924,
      "turn_loss": 0.23167835175991058,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.0894350492473518,
      "grad_norm": 0.523102879524231,
      "learning_rate": 9.441751253965022e-06,
      "loss": 0.1342,
      "mae_dtheta": 0.04481013864278793,
      "mae_dx": 0.01780800148844719,
      "mae_dy": 0.0073148817755281925,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5231029391288757,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 129.92103576660156,
      "model/head/act_norm_mean": 103.31469066722973,
      "model/head/act_norm_min": 70.02423858642578,
      "model/head/act_over_embed": 70.99882267389353,
      "model/head/grad_frac": 0.10905544459819794,
      "model/head/grad_norm": 0.057047225534915924,
      "model/head/grad_zero_frac": 0.00013452323037199676,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6890440244932432,
      "model/head/update_ratio": 0.0009898863499984145,
      "model/head/weight_delta": 5.001538276672363,
      "model/head/weight_delta_rel": 0.08774179220199585,
      "model/head/weight_norm": 57.63007736206055,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41419562697410583,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41419562697410583,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41419562697410583,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28463911261716035,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07558386027812958,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03953814134001732,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012856917455792427,
      "model/modality_embedder.encoders.pose/weight_delta": 1.6204859018325806,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05294632539153099,
      "model/modality_embedder.encoders.pose/weight_norm": 30.752426147460938,
      "model/modality_embedder/grad_frac": 0.07558386027812958,
      "model/modality_embedder/grad_norm": 0.03953814134001732,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0012856917455792427,
      "model/modality_embedder/weight_delta": 1.6204859018325806,
      "model/modality_embedder/weight_delta_rel": 0.05294632539153099,
      "model/modality_embedder/weight_norm": 30.752426147460938,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.49111938476562,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.80441769894895,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.17176628112793,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.671409341039936,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07942735403776169,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.041548680514097214,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015056367265060544,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.9747371077537537,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03552000969648361,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.595420837402344,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.10778045654297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.678891503110254,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.723597526550293,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.272355926212327,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07802154123783112,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.040813297033309937,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014000647934153676,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.211307168006897,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04196062684059143,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.1510066986084,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.81075286865234,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.32656819766195,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.09016227722168,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.404654776500504,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08733520656824112,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0456853024661541,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015186388045549393,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.2888022661209106,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04327556863427162,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.083059310913086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.73490905761719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.332673074860576,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.65263843536377,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.783268829561166,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10330163687467575,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.054037388414144516,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001833062618970871,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.1012173891067505,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.037634383887052536,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.479291915893555,
      "model/normalizer/grad_frac": 0.4290684461593628,
      "model/normalizer/grad_norm": 0.22444696724414825,
      "model/normalizer/grad_zero_frac": 0.00018316945352125913,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002878994680941105,
      "model/normalizer/weight_delta": 2.3559882640838623,
      "model/normalizer/weight_delta_rel": 0.030343765392899513,
      "model/normalizer/weight_norm": 77.96018981933594,
      "pose_mae_dtheta": 0.36021456122398376,
      "pose_mae_dx": 0.131672203540802,
      "pose_mae_dy": 0.0755709633231163,
      "pose_rmse_dtheta": 0.585856556892395,
      "pose_rmse_dx": 0.26445117592811584,
      "pose_rmse_dy": 0.1654379516839981,
      "pose_rmse_mean": 0.3385818898677826,
      "rmse_dtheta": 0.06253524869680405,
      "rmse_dx": 0.030904192477464676,
      "rmse_dy": 0.012863511219620705,
      "rmse_mean": 0.03543432056903839,
      "rotation_flip": 0.017592592164874077,
      "sparse_tokens": 19194.0,
      "step": 1925,
      "turn_loss": 0.3377697467803955,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.08948150901319457,
      "grad_norm": 0.5997231602668762,
      "learning_rate": 9.441143979996413e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.009645993821322918,
      "mae_dx": 0.002393905073404312,
      "mae_dy": 0.0017475055065006018,
      "pose_mae_dtheta": 0.07434023171663284,
      "pose_mae_dx": 0.02453005127608776,
      "pose_mae_dy": 0.025580478832125664,
      "pose_rmse_dtheta": 0.20429226756095886,
      "pose_rmse_dx": 0.061775680631399155,
      "pose_rmse_dy": 0.06544644385576248,
      "pose_rmse_mean": 0.11050479859113693,
      "rmse_dtheta": 0.023734549060463905,
      "rmse_dx": 0.007002984173595905,
      "rmse_dy": 0.003828098066151142,
      "rmse_mean": 0.011521877720952034,
      "rotation_flip": 0.0018416206585243344,
      "sparse_tokens": 32137.0,
      "step": 1926,
      "turn_loss": 0.06906857341527939,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.08952796877903735,
      "grad_norm": 0.5381909012794495,
      "learning_rate": 9.440536395456223e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.007710895501077175,
      "mae_dx": 0.001552519854158163,
      "mae_dy": 0.0016721447464078665,
      "pose_mae_dtheta": 0.05310620740056038,
      "pose_mae_dx": 0.01828731596469879,
      "pose_mae_dy": 0.021236145868897438,
      "pose_rmse_dtheta": 0.11270373314619064,
      "pose_rmse_dx": 0.05261282995343208,
      "pose_rmse_dy": 0.0499253012239933,
      "pose_rmse_mean": 0.07174728810787201,
      "rmse_dtheta": 0.017159366980195045,
      "rmse_dx": 0.004542122595012188,
      "rmse_dy": 0.004760132171213627,
      "rmse_mean": 0.008820540271699429,
      "rotation_flip": 0.0031872510444372892,
      "sparse_tokens": 32137.0,
      "step": 1927,
      "turn_loss": 0.06680379062891006,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.08957442854488014,
      "grad_norm": 0.4141973853111267,
      "learning_rate": 9.439928500386939e-06,
      "loss": 0.1212,
      "mae_dtheta": 0.01235681027173996,
      "mae_dx": 0.0019330873619765043,
      "mae_dy": 0.002585007343441248,
      "pose_mae_dtheta": 0.0836251825094223,
      "pose_mae_dx": 0.027611371129751205,
      "pose_mae_dy": 0.03574955090880394,
      "pose_rmse_dtheta": 0.1878013014793396,
      "pose_rmse_dx": 0.059417590498924255,
      "pose_rmse_dy": 0.08808198571205139,
      "pose_rmse_mean": 0.11176695674657822,
      "rmse_dtheta": 0.025935037061572075,
      "rmse_dx": 0.00547495111823082,
      "rmse_dy": 0.005100588779896498,
      "rmse_mean": 0.01217019185423851,
      "rotation_flip": 0.008613618090748787,
      "sparse_tokens": 32089.0,
      "step": 1928,
      "turn_loss": 0.09775801748037338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08962088831072292,
      "grad_norm": 0.4158177971839905,
      "learning_rate": 9.439320294831072e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.012903997674584389,
      "mae_dx": 0.0024518617428839207,
      "mae_dy": 0.003914110362529755,
      "pose_mae_dtheta": 0.09010771661996841,
      "pose_mae_dx": 0.03620116040110588,
      "pose_mae_dy": 0.04595600813627243,
      "pose_rmse_dtheta": 0.18743859231472015,
      "pose_rmse_dx": 0.08622872084379196,
      "pose_rmse_dy": 0.12482843548059464,
      "pose_rmse_mean": 0.13283191621303558,
      "rmse_dtheta": 0.023971183225512505,
      "rmse_dx": 0.0063970740884542465,
      "rmse_dy": 0.008283696137368679,
      "rmse_mean": 0.012883985415101051,
      "rotation_flip": 0.006471389438956976,
      "sparse_tokens": 32121.0,
      "step": 1929,
      "turn_loss": 0.10688626021146774,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 40238.0,
      "epoch": 0.08966734807656569,
      "grad_norm": 0.7598131895065308,
      "learning_rate": 9.438711778831154e-06,
      "loss": 0.2841,
      "mae_dtheta": 0.029560871422290802,
      "mae_dx": 0.01212551724165678,
      "mae_dy": 0.004478755872696638,
      "pose_mae_dtheta": 0.23418083786964417,
      "pose_mae_dx": 0.09574242681264877,
      "pose_mae_dy": 0.052666015923023224,
      "pose_rmse_dtheta": 0.4153377115726471,
      "pose_rmse_dx": 0.20724345743656158,
      "pose_rmse_dy": 0.1446826308965683,
      "pose_rmse_mean": 0.25575461983680725,
      "rmse_dtheta": 0.04639003425836563,
      "rmse_dx": 0.024021953344345093,
      "rmse_dy": 0.010468285530805588,
      "rmse_mean": 0.026960089802742004,
      "rotation_flip": 0.015167931094765663,
      "sparse_tokens": 30038.0,
      "step": 1930,
      "turn_loss": 0.2580636143684387,
      "turns": 124.0,
      "turns_per_sample": 124.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.08971380784240847,
      "grad_norm": 0.6430201530456543,
      "learning_rate": 9.438102952429737e-06,
      "loss": 0.1703,
      "mae_dtheta": 0.017306551337242126,
      "mae_dx": 0.004360990598797798,
      "mae_dy": 0.006316882558166981,
      "pose_mae_dtheta": 0.11600014567375183,
      "pose_mae_dx": 0.04941387102007866,
      "pose_mae_dy": 0.06198742240667343,
      "pose_rmse_dtheta": 0.224069282412529,
      "pose_rmse_dx": 0.11400371044874191,
      "pose_rmse_dy": 0.16648799180984497,
      "pose_rmse_mean": 0.1681869924068451,
      "rmse_dtheta": 0.030771024525165558,
      "rmse_dx": 0.010939886793494225,
      "rmse_dy": 0.014753672294318676,
      "rmse_mean": 0.018821530044078827,
      "rotation_flip": 0.008574150502681732,
      "sparse_tokens": 32137.0,
      "step": 1931,
      "turn_loss": 0.17036603391170502,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6824.0,
      "epoch": 0.08976026760825126,
      "grad_norm": 0.8643561005592346,
      "learning_rate": 9.4374938156694e-06,
      "loss": 0.1569,
      "mae_dtheta": 0.027162890881299973,
      "mae_dx": 0.01082003302872181,
      "mae_dy": 0.0051196482963860035,
      "pose_mae_dtheta": 0.19751578569412231,
      "pose_mae_dx": 0.09110939502716064,
      "pose_mae_dy": 0.08772972971200943,
      "pose_rmse_dtheta": 0.3431064486503601,
      "pose_rmse_dx": 0.24585966765880585,
      "pose_rmse_dy": 0.18110744655132294,
      "pose_rmse_mean": 0.25669121742248535,
      "rmse_dtheta": 0.042180340737104416,
      "rmse_dx": 0.0241287499666214,
      "rmse_dy": 0.009233604185283184,
      "rmse_mean": 0.02518089860677719,
      "rotation_flip": 0.010273972526192665,
      "sparse_tokens": 5312.0,
      "step": 1932,
      "turn_loss": 0.2549399435520172,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.08980672737409404,
      "grad_norm": 0.7861862778663635,
      "learning_rate": 9.43688436859274e-06,
      "loss": 0.1172,
      "mae_dtheta": 0.022183667868375778,
      "mae_dx": 0.011687284335494041,
      "mae_dy": 0.003216756507754326,
      "pose_mae_dtheta": 0.16698333621025085,
      "pose_mae_dx": 0.08328802138566971,
      "pose_mae_dy": 0.05011337623000145,
      "pose_rmse_dtheta": 0.32603201270103455,
      "pose_rmse_dx": 0.16365186870098114,
      "pose_rmse_dy": 0.14263354241847992,
      "pose_rmse_mean": 0.21077248454093933,
      "rmse_dtheta": 0.038154833018779755,
      "rmse_dx": 0.022639723494648933,
      "rmse_dy": 0.00583534874022007,
      "rmse_mean": 0.02220996841788292,
      "rotation_flip": 0.018927445635199547,
      "sparse_tokens": 5266.0,
      "step": 1933,
      "turn_loss": 0.20532818138599396,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08985318713993681,
      "grad_norm": 0.6450983285903931,
      "learning_rate": 9.436274611242373e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.008763556368649006,
      "mae_dx": 0.0016136884223669767,
      "mae_dy": 0.0019843410700559616,
      "pose_mae_dtheta": 0.06061071902513504,
      "pose_mae_dx": 0.022085268050432205,
      "pose_mae_dy": 0.025601554661989212,
      "pose_rmse_dtheta": 0.15359441936016083,
      "pose_rmse_dx": 0.05867195129394531,
      "pose_rmse_dy": 0.06492739170789719,
      "pose_rmse_mean": 0.09239792078733444,
      "rmse_dtheta": 0.018575575202703476,
      "rmse_dx": 0.004489343613386154,
      "rmse_dy": 0.004089267458766699,
      "rmse_mean": 0.009051395580172539,
      "rotation_flip": 0.0018525379709899426,
      "sparse_tokens": 32121.0,
      "step": 1934,
      "turn_loss": 0.06913770735263824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.08989964690577959,
      "grad_norm": 0.686249315738678,
      "learning_rate": 9.435664543660943e-06,
      "loss": 0.1255,
      "mae_dtheta": 0.03960688039660454,
      "mae_dx": 0.014695595018565655,
      "mae_dy": 0.006926408503204584,
      "pose_mae_dtheta": 0.31580623984336853,
      "pose_mae_dx": 0.11481761932373047,
      "pose_mae_dy": 0.0741749256849289,
      "pose_rmse_dtheta": 0.5224999189376831,
      "pose_rmse_dx": 0.2250385880470276,
      "pose_rmse_dy": 0.1658490002155304,
      "pose_rmse_mean": 0.3044625222682953,
      "rmse_dtheta": 0.057252366095781326,
      "rmse_dx": 0.026350732892751694,
      "rmse_dy": 0.014666900038719177,
      "rmse_mean": 0.03275666758418083,
      "rotation_flip": 0.01659291982650757,
      "sparse_tokens": 14784.0,
      "step": 1935,
      "turn_loss": 0.3436574339866638,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 23618.0,
      "epoch": 0.08994610667162238,
      "grad_norm": 0.659536600112915,
      "learning_rate": 9.43505416589111e-06,
      "loss": 0.2087,
      "mae_dtheta": 0.03226063773036003,
      "mae_dx": 0.013767249882221222,
      "mae_dy": 0.005337722599506378,
      "pose_mae_dtheta": 0.24323171377182007,
      "pose_mae_dx": 0.11210793256759644,
      "pose_mae_dy": 0.08156566321849823,
      "pose_rmse_dtheta": 0.4259868860244751,
      "pose_rmse_dx": 0.25412601232528687,
      "pose_rmse_dy": 0.16557477414608002,
      "pose_rmse_mean": 0.2818959057331085,
      "rmse_dtheta": 0.048361677676439285,
      "rmse_dx": 0.027496250346302986,
      "rmse_dy": 0.011699715629220009,
      "rmse_mean": 0.029185881838202477,
      "rotation_flip": 0.01864573173224926,
      "sparse_tokens": 18776.0,
      "step": 1936,
      "turn_loss": 0.24798673391342163,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.08999256643746516,
      "grad_norm": 0.6588825583457947,
      "learning_rate": 9.434443477975557e-06,
      "loss": 0.1667,
      "mae_dtheta": 0.012787441723048687,
      "mae_dx": 0.002212214982137084,
      "mae_dy": 0.002646737964823842,
      "pose_mae_dtheta": 0.08567611873149872,
      "pose_mae_dx": 0.028599292039871216,
      "pose_mae_dy": 0.03069356083869934,
      "pose_rmse_dtheta": 0.2201220840215683,
      "pose_rmse_dx": 0.06730148196220398,
      "pose_rmse_dy": 0.071495920419693,
      "pose_rmse_mean": 0.11963982880115509,
      "rmse_dtheta": 0.0281357541680336,
      "rmse_dx": 0.005882990546524525,
      "rmse_dy": 0.006732959765940905,
      "rmse_mean": 0.013583901338279247,
      "rotation_flip": 0.0063567738980054855,
      "sparse_tokens": 32121.0,
      "step": 1937,
      "turn_loss": 0.10761166363954544,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.09003902620330793,
      "grad_norm": 0.58636075258255,
      "learning_rate": 9.433832479956993e-06,
      "loss": 0.1387,
      "mae_dtheta": 0.01679525524377823,
      "mae_dx": 0.003279502037912607,
      "mae_dy": 0.003967602271586657,
      "pose_mae_dtheta": 0.11812932044267654,
      "pose_mae_dx": 0.039295095950365067,
      "pose_mae_dy": 0.040323495864868164,
      "pose_rmse_dtheta": 0.2469329833984375,
      "pose_rmse_dx": 0.10244348645210266,
      "pose_rmse_dy": 0.08414143323898315,
      "pose_rmse_mean": 0.14450597763061523,
      "rmse_dtheta": 0.03253650665283203,
      "rmse_dx": 0.008821627125144005,
      "rmse_dy": 0.008394190110266209,
      "rmse_mean": 0.016584109514951706,
      "rotation_flip": 0.0052011096850037575,
      "sparse_tokens": 32105.0,
      "step": 1938,
      "turn_loss": 0.15183672308921814,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.09008548596915071,
      "grad_norm": 0.6081134080886841,
      "learning_rate": 9.433221171878144e-06,
      "loss": 0.1774,
      "mae_dtheta": 0.02953488379716873,
      "mae_dx": 0.010362285189330578,
      "mae_dy": 0.0033273198641836643,
      "pose_mae_dtheta": 0.21293117105960846,
      "pose_mae_dx": 0.07659782469272614,
      "pose_mae_dy": 0.037009935826063156,
      "pose_rmse_dtheta": 0.3970659375190735,
      "pose_rmse_dx": 0.23148253560066223,
      "pose_rmse_dy": 0.06905792653560638,
      "pose_rmse_mean": 0.2325354814529419,
      "rmse_dtheta": 0.0494961142539978,
      "rmse_dx": 0.024787990376353264,
      "rmse_dy": 0.006034348160028458,
      "rmse_mean": 0.026772817596793175,
      "rotation_flip": 0.012121211737394333,
      "sparse_tokens": 3595.0,
      "step": 1939,
      "turn_loss": 0.1681063026189804,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0901319457349935,
      "grad_norm": 0.6140148043632507,
      "learning_rate": 9.43260955378176e-06,
      "loss": 0.0842,
      "mae_dtheta": 0.010721085593104362,
      "mae_dx": 0.0018653185106813908,
      "mae_dy": 0.002537916414439678,
      "pose_mae_dtheta": 0.07090164721012115,
      "pose_mae_dx": 0.023509714752435684,
      "pose_mae_dy": 0.032249923795461655,
      "pose_rmse_dtheta": 0.14361311495304108,
      "pose_rmse_dx": 0.06074633449316025,
      "pose_rmse_dy": 0.0710311010479927,
      "pose_rmse_mean": 0.09179684519767761,
      "rmse_dtheta": 0.020839348435401917,
      "rmse_dx": 0.005559480749070644,
      "rmse_dy": 0.005341564305126667,
      "rmse_mean": 0.010580131784081459,
      "rotation_flip": 0.0035771066322922707,
      "sparse_tokens": 32089.0,
      "step": 1940,
      "turn_loss": 0.08534014225006104,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15544.0,
      "epoch": 0.09017840550083628,
      "grad_norm": 0.48735547065734863,
      "learning_rate": 9.43199762571061e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.035272084176540375,
      "mae_dx": 0.014387072995305061,
      "mae_dy": 0.004595162812620401,
      "pose_mae_dtheta": 0.2786376178264618,
      "pose_mae_dx": 0.11677268892526627,
      "pose_mae_dy": 0.06435363739728928,
      "pose_rmse_dtheta": 0.4994172751903534,
      "pose_rmse_dx": 0.2589130401611328,
      "pose_rmse_dy": 0.16074201464653015,
      "pose_rmse_mean": 0.3063574731349945,
      "rmse_dtheta": 0.054591961205005646,
      "rmse_dx": 0.027766898274421692,
      "rmse_dy": 0.009345336817204952,
      "rmse_mean": 0.030568066984415054,
      "rotation_flip": 0.007194244768470526,
      "sparse_tokens": 12909.0,
      "step": 1941,
      "turn_loss": 0.2753707468509674,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.09022486526667906,
      "grad_norm": 0.5334796905517578,
      "learning_rate": 9.431385387707486e-06,
      "loss": 0.126,
      "mae_dtheta": 0.01055885385721922,
      "mae_dx": 0.001480773207731545,
      "mae_dy": 0.0027382378466427326,
      "pose_mae_dtheta": 0.07068163901567459,
      "pose_mae_dx": 0.023167578503489494,
      "pose_mae_dy": 0.03128288686275482,
      "pose_rmse_dtheta": 0.13202527165412903,
      "pose_rmse_dx": 0.05209459736943245,
      "pose_rmse_dy": 0.06882018595933914,
      "pose_rmse_mean": 0.08431335538625717,
      "rmse_dtheta": 0.019737165421247482,
      "rmse_dx": 0.004012486897408962,
      "rmse_dy": 0.00571105070412159,
      "rmse_mean": 0.009820234961807728,
      "rotation_flip": 0.005394470877945423,
      "sparse_tokens": 32105.0,
      "step": 1942,
      "turn_loss": 0.08635572344064713,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.09027132503252183,
      "grad_norm": 0.4301195442676544,
      "learning_rate": 9.430772839815203e-06,
      "loss": 0.0985,
      "mae_dtheta": 0.0430113822221756,
      "mae_dx": 0.015050304122269154,
      "mae_dy": 0.004411106929183006,
      "pose_mae_dtheta": 0.3542441129684448,
      "pose_mae_dx": 0.11994296312332153,
      "pose_mae_dy": 0.04890241101384163,
      "pose_rmse_dtheta": 0.6117589473724365,
      "pose_rmse_dx": 0.25249120593070984,
      "pose_rmse_dy": 0.10942107439041138,
      "pose_rmse_mean": 0.3245570957660675,
      "rmse_dtheta": 0.06329198181629181,
      "rmse_dx": 0.026589659973978996,
      "rmse_dy": 0.009038455784320831,
      "rmse_mean": 0.03297336772084236,
      "rotation_flip": 0.013254786841571331,
      "sparse_tokens": 10600.0,
      "step": 1943,
      "turn_loss": 0.24412302672863007,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 32338.0,
      "epoch": 0.09031778479836462,
      "grad_norm": 0.5477063059806824,
      "learning_rate": 9.430159982076599e-06,
      "loss": 0.1108,
      "mae_dtheta": 0.032297708094120026,
      "mae_dx": 0.012582840397953987,
      "mae_dy": 0.006656459998339415,
      "pose_mae_dtheta": 0.27173763513565063,
      "pose_mae_dx": 0.10082406550645828,
      "pose_mae_dy": 0.09035582095384598,
      "pose_rmse_dtheta": 0.4664783179759979,
      "pose_rmse_dx": 0.21885469555854797,
      "pose_rmse_dy": 0.21125175058841705,
      "pose_rmse_mean": 0.2988615930080414,
      "rmse_dtheta": 0.04857799783349037,
      "rmse_dx": 0.024881970137357712,
      "rmse_dy": 0.012993186712265015,
      "rmse_mean": 0.028817718848586082,
      "rotation_flip": 0.015482055023312569,
      "sparse_tokens": 26450.0,
      "step": 1944,
      "turn_loss": 0.2688981890678406,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0903642445642074,
      "grad_norm": 0.552186906337738,
      "learning_rate": 9.429546814534528e-06,
      "loss": 0.1404,
      "mae_dtheta": 0.01154711376875639,
      "mae_dx": 0.003121195826679468,
      "mae_dy": 0.0028974947053939104,
      "pose_mae_dtheta": 0.07997728139162064,
      "pose_mae_dx": 0.03434688597917557,
      "pose_mae_dy": 0.0307739470154047,
      "pose_rmse_dtheta": 0.16515780985355377,
      "pose_rmse_dx": 0.09356164187192917,
      "pose_rmse_dy": 0.06980854272842407,
      "pose_rmse_mean": 0.10950933396816254,
      "rmse_dtheta": 0.021803509443998337,
      "rmse_dx": 0.009291885420680046,
      "rmse_dy": 0.006067927926778793,
      "rmse_mean": 0.012387774884700775,
      "rotation_flip": 0.0023972601629793644,
      "sparse_tokens": 32121.0,
      "step": 1945,
      "turn_loss": 0.11108342558145523,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.09041070433005018,
      "grad_norm": 0.384445458650589,
      "learning_rate": 9.428933337231872e-06,
      "loss": 0.1031,
      "mae_dtheta": 0.006653313059359789,
      "mae_dx": 0.0013379243900999427,
      "mae_dy": 0.0012006118195131421,
      "pose_mae_dtheta": 0.05084686353802681,
      "pose_mae_dx": 0.015446538105607033,
      "pose_mae_dy": 0.019270526245236397,
      "pose_rmse_dtheta": 0.1545349508523941,
      "pose_rmse_dx": 0.045028749853372574,
      "pose_rmse_dy": 0.05122292786836624,
      "pose_rmse_mean": 0.08359554409980774,
      "rmse_dtheta": 0.01876690797507763,
      "rmse_dx": 0.004765251651406288,
      "rmse_dy": 0.002959122881293297,
      "rmse_mean": 0.008830428123474121,
      "rotation_flip": 0.0013297871919348836,
      "sparse_tokens": 32057.0,
      "step": 1946,
      "turn_loss": 0.051096778362989426,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09045716409589295,
      "grad_norm": 0.622001588344574,
      "learning_rate": 9.428319550211531e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.013712006621062756,
      "mae_dx": 0.0019351233495399356,
      "mae_dy": 0.0030266789253801107,
      "pose_mae_dtheta": 0.09088501334190369,
      "pose_mae_dx": 0.02842489443719387,
      "pose_mae_dy": 0.03869045153260231,
      "pose_rmse_dtheta": 0.1983225792646408,
      "pose_rmse_dx": 0.0699741467833519,
      "pose_rmse_dy": 0.07823435962200165,
      "pose_rmse_mean": 0.11551036685705185,
      "rmse_dtheta": 0.025916842743754387,
      "rmse_dx": 0.005291452165693045,
      "rmse_dy": 0.005838381126523018,
      "rmse_mean": 0.012348893098533154,
      "rotation_flip": 0.004444444552063942,
      "sparse_tokens": 32089.0,
      "step": 1947,
      "turn_loss": 0.11119488626718521,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.09050362386173574,
      "grad_norm": 0.46662864089012146,
      "learning_rate": 9.427705453516427e-06,
      "loss": 0.1552,
      "mae_dtheta": 0.031601887196302414,
      "mae_dx": 0.015026264823973179,
      "mae_dy": 0.004050940740853548,
      "pose_mae_dtheta": 0.23695093393325806,
      "pose_mae_dx": 0.11767707765102386,
      "pose_mae_dy": 0.047633785754442215,
      "pose_rmse_dtheta": 0.4339536428451538,
      "pose_rmse_dx": 0.2557717561721802,
      "pose_rmse_dy": 0.10602566599845886,
      "pose_rmse_mean": 0.26525038480758667,
      "rmse_dtheta": 0.04915116727352142,
      "rmse_dx": 0.028185924515128136,
      "rmse_dy": 0.007403303403407335,
      "rmse_mean": 0.02824680134654045,
      "rotation_flip": 0.01387604046612978,
      "sparse_tokens": 18520.0,
      "step": 1948,
      "turn_loss": 0.24678006768226624,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.09055008362757852,
      "grad_norm": 0.6020262241363525,
      "learning_rate": 9.427091047189503e-06,
      "loss": 0.1067,
      "mae_dtheta": 0.010283716954290867,
      "mae_dx": 0.0020401098299771547,
      "mae_dy": 0.0014653319958597422,
      "pose_mae_dtheta": 0.07662622630596161,
      "pose_mae_dx": 0.01969018578529358,
      "pose_mae_dy": 0.022794369608163834,
      "pose_rmse_dtheta": 0.21301476657390594,
      "pose_rmse_dx": 0.0509813167154789,
      "pose_rmse_dy": 0.052456557750701904,
      "pose_rmse_mean": 0.10548421740531921,
      "rmse_dtheta": 0.02466486766934395,
      "rmse_dx": 0.006212436128407717,
      "rmse_dy": 0.0031182055827230215,
      "rmse_mean": 0.011331836692988873,
      "rotation_flip": 0.005502063315361738,
      "sparse_tokens": 32105.0,
      "step": 1949,
      "turn_loss": 0.07604441791772842,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.0905965433934213,
      "grad_norm": 0.4689033627510071,
      "learning_rate": 9.426476331273726e-06,
      "loss": 0.1232,
      "mae_dtheta": 0.013058693148195744,
      "mae_dx": 0.0019116915063932538,
      "mae_dy": 0.0029583824798464775,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.46890342235565186,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.55430603027344,
      "model/head/act_norm_mean": 108.80582189078282,
      "model/head/act_norm_min": 68.34810638427734,
      "model/head/act_over_embed": 74.77237945949969,
      "model/head/grad_frac": 0.104684017598629,
      "model/head/grad_norm": 0.04908669367432594,
      "model/head/grad_zero_frac": 0.00017608582857064903,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6852854719065656,
      "model/head/update_ratio": 0.0008516370435245335,
      "model/head/weight_delta": 5.040545463562012,
      "model/head/weight_delta_rel": 0.08842609822750092,
      "model/head/weight_norm": 57.63804244995117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4143906235694885,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41432076666552947,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4142409563064575,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28472510978468296,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08600017428398132,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04032577574253082,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5411520878820961,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013112546876072884,
      "model/modality_embedder.encoders.pose/weight_delta": 1.6355171203613281,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05343744158744812,
      "model/modality_embedder.encoders.pose/weight_norm": 30.75358009338379,
      "model/modality_embedder/grad_frac": 0.08600017428398132,
      "model/modality_embedder/grad_norm": 0.04032577574253082,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5411520878820961,
      "model/modality_embedder/update_ratio": 0.0013112546876072884,
      "model/modality_embedder/weight_delta": 1.6355171203613281,
      "model/modality_embedder/weight_delta_rel": 0.05343744158744812,
      "model/modality_embedder/weight_norm": 30.75358009338379,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.8602523803711,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.346981721981724,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.936201095581055,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.044264417232473,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07976502180099487,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03740209341049194,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013552755117416382,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.9854464530944824,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.035910263657569885,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.597410202026367,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.19052124023438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.43922107984608,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.402758598327637,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.794861529662835,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06623974442481995,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03106004372239113,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001065365388058126,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.2253894805908203,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04244844987988472,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.15435791015625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.01351165771484,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.405029962321628,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.541383743286133,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.14578379789275,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07057267427444458,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.033091768622398376,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010998670477420092,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.304174542427063,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04379173740744591,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.08706283569336,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.67292785644531,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.28056357223024,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.449670791625977,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.434668053644252,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08364365994930267,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03922079876065254,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013303535524755716,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.1136668920516968,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03805984929203987,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.48148536682129,
      "model/normalizer/grad_frac": 0.36578723788261414,
      "model/normalizer/grad_norm": 0.17151889204978943,
      "model/normalizer/grad_zero_frac": 0.00020325901277828962,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021999741438776255,
      "model/normalizer/weight_delta": 2.383216619491577,
      "model/normalizer/weight_delta_rel": 0.030694449320435524,
      "model/normalizer/weight_norm": 77.96405029296875,
      "pose_mae_dtheta": 0.09587831050157547,
      "pose_mae_dx": 0.02867579273879528,
      "pose_mae_dy": 0.04121364653110504,
      "pose_rmse_dtheta": 0.22656136751174927,
      "pose_rmse_dx": 0.06793569028377533,
      "pose_rmse_dy": 0.1195218488574028,
      "pose_rmse_mean": 0.1380063146352768,
      "rmse_dtheta": 0.025866640731692314,
      "rmse_dx": 0.005242584273219109,
      "rmse_dy": 0.006234629545360804,
      "rmse_mean": 0.012447952292859554,
      "rotation_flip": 0.0070596542209386826,
      "sparse_tokens": 32153.0,
      "step": 1950,
      "turn_loss": 0.10307406634092331,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.09064300315926407,
      "grad_norm": 0.6640267372131348,
      "learning_rate": 9.425861305812083e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.033868636935949326,
      "mae_dx": 0.008625810965895653,
      "mae_dy": 0.0046022189781069756,
      "pose_mae_dtheta": 0.2463647723197937,
      "pose_mae_dx": 0.07126910239458084,
      "pose_mae_dy": 0.07328126579523087,
      "pose_rmse_dtheta": 0.4118519127368927,
      "pose_rmse_dx": 0.1666591465473175,
      "pose_rmse_dy": 0.15293565392494202,
      "pose_rmse_mean": 0.2438155859708786,
      "rmse_dtheta": 0.04861190915107727,
      "rmse_dx": 0.0207807719707489,
      "rmse_dy": 0.008419666439294815,
      "rmse_mean": 0.02593744918704033,
      "rotation_flip": 0.01342281885445118,
      "sparse_tokens": 5605.0,
      "step": 1951,
      "turn_loss": 0.19425766170024872,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.09068946292510685,
      "grad_norm": 0.945492148399353,
      "learning_rate": 9.425245970847586e-06,
      "loss": 0.2173,
      "mae_dtheta": 0.01738678477704525,
      "mae_dx": 0.006930232048034668,
      "mae_dy": 0.0021620222833007574,
      "pose_mae_dtheta": 0.14166899025440216,
      "pose_mae_dx": 0.05033978447318077,
      "pose_mae_dy": 0.02613331750035286,
      "pose_rmse_dtheta": 0.2867578864097595,
      "pose_rmse_dx": 0.16803090274333954,
      "pose_rmse_dy": 0.0463733971118927,
      "pose_rmse_mean": 0.16705405712127686,
      "rmse_dtheta": 0.0316319577395916,
      "rmse_dx": 0.018901512026786804,
      "rmse_dy": 0.004278199281543493,
      "rmse_mean": 0.01827055588364601,
      "rotation_flip": 0.0042553190141916275,
      "sparse_tokens": 4032.0,
      "step": 1952,
      "turn_loss": 0.11287043988704681,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09073592269094964,
      "grad_norm": 0.6792128086090088,
      "learning_rate": 9.42463032642326e-06,
      "loss": 0.2021,
      "mae_dtheta": 0.011562780477106571,
      "mae_dx": 0.0018739658407866955,
      "mae_dy": 0.0035796603187918663,
      "pose_mae_dtheta": 0.08313214033842087,
      "pose_mae_dx": 0.03272002190351486,
      "pose_mae_dy": 0.03801903501152992,
      "pose_rmse_dtheta": 0.17127561569213867,
      "pose_rmse_dx": 0.08242035657167435,
      "pose_rmse_dy": 0.08185947686433792,
      "pose_rmse_mean": 0.11185181140899658,
      "rmse_dtheta": 0.021997561678290367,
      "rmse_dx": 0.0047195409424602985,
      "rmse_dy": 0.007056794594973326,
      "rmse_mean": 0.011257965117692947,
      "rotation_flip": 0.0021352313924580812,
      "sparse_tokens": 32089.0,
      "step": 1953,
      "turn_loss": 0.10928808897733688,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.09078238245679242,
      "grad_norm": 0.5731714963912964,
      "learning_rate": 9.424014372582161e-06,
      "loss": 0.1422,
      "mae_dtheta": 0.012759283185005188,
      "mae_dx": 0.0019217721419408917,
      "mae_dy": 0.0020360040944069624,
      "pose_mae_dtheta": 0.09017437696456909,
      "pose_mae_dx": 0.023574942722916603,
      "pose_mae_dy": 0.02851955220103264,
      "pose_rmse_dtheta": 0.2413618415594101,
      "pose_rmse_dx": 0.05205541104078293,
      "pose_rmse_dy": 0.0672907829284668,
      "pose_rmse_mean": 0.12023600935935974,
      "rmse_dtheta": 0.02934851683676243,
      "rmse_dx": 0.005298292264342308,
      "rmse_dy": 0.004137874115258455,
      "rmse_mean": 0.01292822789400816,
      "rotation_flip": 0.0038910505827516317,
      "sparse_tokens": 32105.0,
      "step": 1954,
      "turn_loss": 0.10482040792703629,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0908288422226352,
      "grad_norm": 0.44260287284851074,
      "learning_rate": 9.423398109367363e-06,
      "loss": 0.1588,
      "mae_dtheta": 0.012556883506476879,
      "mae_dx": 0.0032393066212534904,
      "mae_dy": 0.0039336769841611385,
      "pose_mae_dtheta": 0.08669430762529373,
      "pose_mae_dx": 0.04159325361251831,
      "pose_mae_dy": 0.04211701825261116,
      "pose_rmse_dtheta": 0.1888720989227295,
      "pose_rmse_dx": 0.10649282485246658,
      "pose_rmse_dy": 0.11922738701105118,
      "pose_rmse_mean": 0.13819743692874908,
      "rmse_dtheta": 0.025004900991916656,
      "rmse_dx": 0.008414999581873417,
      "rmse_dy": 0.008489574305713177,
      "rmse_mean": 0.013969825580716133,
      "rotation_flip": 0.005233644973486662,
      "sparse_tokens": 32121.0,
      "step": 1955,
      "turn_loss": 0.1267702728509903,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.09087530198847797,
      "grad_norm": 0.43612608313560486,
      "learning_rate": 9.42278153682196e-06,
      "loss": 0.1024,
      "mae_dtheta": 0.011472225189208984,
      "mae_dx": 0.0022529230918735266,
      "mae_dy": 0.0021636795718222857,
      "pose_mae_dtheta": 0.07868825644254684,
      "pose_mae_dx": 0.025740299373865128,
      "pose_mae_dy": 0.030154576525092125,
      "pose_rmse_dtheta": 0.1961381733417511,
      "pose_rmse_dx": 0.05929647013545036,
      "pose_rmse_dy": 0.06837830692529678,
      "pose_rmse_mean": 0.10793764889240265,
      "rmse_dtheta": 0.02405768446624279,
      "rmse_dx": 0.006665450986474752,
      "rmse_dy": 0.004239417612552643,
      "rmse_mean": 0.011654185131192207,
      "rotation_flip": 0.0066562253050506115,
      "sparse_tokens": 32121.0,
      "step": 1956,
      "turn_loss": 0.08766873925924301,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.09092176175432076,
      "grad_norm": 0.6647195219993591,
      "learning_rate": 9.422164654989073e-06,
      "loss": 0.1588,
      "mae_dtheta": 0.03498358651995659,
      "mae_dx": 0.017210690304636955,
      "mae_dy": 0.00680548045784235,
      "pose_mae_dtheta": 0.27209728956222534,
      "pose_mae_dx": 0.1206854060292244,
      "pose_mae_dy": 0.08669073134660721,
      "pose_rmse_dtheta": 0.49367013573646545,
      "pose_rmse_dx": 0.24289435148239136,
      "pose_rmse_dy": 0.24105125665664673,
      "pose_rmse_mean": 0.32587194442749023,
      "rmse_dtheta": 0.05276140943169594,
      "rmse_dx": 0.0305230300873518,
      "rmse_dy": 0.016784096136689186,
      "rmse_mean": 0.03335617855191231,
      "rotation_flip": 0.02400960400700569,
      "sparse_tokens": 14069.0,
      "step": 1957,
      "turn_loss": 0.3030426502227783,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.09096822152016354,
      "grad_norm": 0.5690559148788452,
      "learning_rate": 9.421547463911835e-06,
      "loss": 0.1374,
      "mae_dtheta": 0.025816524401307106,
      "mae_dx": 0.00754544697701931,
      "mae_dy": 0.006044830195605755,
      "pose_mae_dtheta": 0.20696961879730225,
      "pose_mae_dx": 0.08761275559663773,
      "pose_mae_dy": 0.09111292660236359,
      "pose_rmse_dtheta": 0.37576940655708313,
      "pose_rmse_dx": 0.2252892106771469,
      "pose_rmse_dy": 0.20282985270023346,
      "pose_rmse_mean": 0.26796281337738037,
      "rmse_dtheta": 0.0418352410197258,
      "rmse_dx": 0.019895466044545174,
      "rmse_dy": 0.012058860622346401,
      "rmse_mean": 0.024596523493528366,
      "rotation_flip": 0.010526316240429878,
      "sparse_tokens": 12644.0,
      "step": 1958,
      "turn_loss": 0.21770067512989044,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.09101468128600632,
      "grad_norm": 0.8874293565750122,
      "learning_rate": 9.420929963633411e-06,
      "loss": 0.1215,
      "mae_dtheta": 0.021012788638472557,
      "mae_dx": 0.013735933229327202,
      "mae_dy": 0.004727738443762064,
      "pose_mae_dtheta": 0.17305584251880646,
      "pose_mae_dx": 0.13192495703697205,
      "pose_mae_dy": 0.05369524285197258,
      "pose_rmse_dtheta": 0.28230199217796326,
      "pose_rmse_dx": 0.28673043847084045,
      "pose_rmse_dy": 0.09488546848297119,
      "pose_rmse_mean": 0.2213059663772583,
      "rmse_dtheta": 0.031482383608818054,
      "rmse_dx": 0.027623942121863365,
      "rmse_dy": 0.00796495471149683,
      "rmse_mean": 0.022357095032930374,
      "rotation_flip": 0.016759777441620827,
      "sparse_tokens": 3328.0,
      "step": 1959,
      "turn_loss": 0.20457910001277924,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09106114105184909,
      "grad_norm": 0.49482467770576477,
      "learning_rate": 9.420312154196983e-06,
      "loss": 0.135,
      "mae_dtheta": 0.011787284165620804,
      "mae_dx": 0.0026157116517424583,
      "mae_dy": 0.0022672140039503574,
      "pose_mae_dtheta": 0.08729223161935806,
      "pose_mae_dx": 0.028868386521935463,
      "pose_mae_dy": 0.029321717098355293,
      "pose_rmse_dtheta": 0.2152724415063858,
      "pose_rmse_dx": 0.0782892182469368,
      "pose_rmse_dy": 0.0669291540980339,
      "pose_rmse_mean": 0.12016361206769943,
      "rmse_dtheta": 0.03245193138718605,
      "rmse_dx": 0.007876846008002758,
      "rmse_dy": 0.004948413465172052,
      "rmse_mean": 0.015092398039996624,
      "rotation_flip": 0.0021344716660678387,
      "sparse_tokens": 32089.0,
      "step": 1960,
      "turn_loss": 0.17270244657993317,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09110760081769188,
      "grad_norm": 0.535874605178833,
      "learning_rate": 9.419694035645753e-06,
      "loss": 0.1525,
      "mae_dtheta": 0.010566411539912224,
      "mae_dx": 0.0015527240466326475,
      "mae_dy": 0.001840124255977571,
      "pose_mae_dtheta": 0.07399290055036545,
      "pose_mae_dx": 0.019318539649248123,
      "pose_mae_dy": 0.025208909064531326,
      "pose_rmse_dtheta": 0.20372936129570007,
      "pose_rmse_dx": 0.04990765452384949,
      "pose_rmse_dy": 0.05804230272769928,
      "pose_rmse_mean": 0.10389310121536255,
      "rmse_dtheta": 0.025184471160173416,
      "rmse_dx": 0.004785736091434956,
      "rmse_dy": 0.004023764748126268,
      "rmse_mean": 0.01133132353425026,
      "rotation_flip": 0.005769230891019106,
      "sparse_tokens": 32073.0,
      "step": 1961,
      "turn_loss": 0.0799805074930191,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 43490.0,
      "epoch": 0.09115406058353466,
      "grad_norm": 1.0731785297393799,
      "learning_rate": 9.419075608022946e-06,
      "loss": 0.2206,
      "mae_dtheta": 0.02970537543296814,
      "mae_dx": 0.014307897537946701,
      "mae_dy": 0.003977038431912661,
      "pose_mae_dtheta": 0.22730232775211334,
      "pose_mae_dx": 0.11232780665159225,
      "pose_mae_dy": 0.04461842402815819,
      "pose_rmse_dtheta": 0.4199883043766022,
      "pose_rmse_dx": 0.25321972370147705,
      "pose_rmse_dy": 0.1216551661491394,
      "pose_rmse_mean": 0.2649543881416321,
      "rmse_dtheta": 0.047330498695373535,
      "rmse_dx": 0.027700597420334816,
      "rmse_dy": 0.009043695405125618,
      "rmse_mean": 0.028024930506944656,
      "rotation_flip": 0.01729910634458065,
      "sparse_tokens": 30290.0,
      "step": 1962,
      "turn_loss": 0.26193830370903015,
      "turns": 134.0,
      "turns_per_sample": 134.0
    },
    {
      "dense_tokens": 19742.0,
      "epoch": 0.09120052034937744,
      "grad_norm": 0.679577112197876,
      "learning_rate": 9.41845687137181e-06,
      "loss": 0.163,
      "mae_dtheta": 0.031068354845046997,
      "mae_dx": 0.008711927570402622,
      "mae_dy": 0.004776573274284601,
      "pose_mae_dtheta": 0.2603819668292999,
      "pose_mae_dx": 0.08214648067951202,
      "pose_mae_dy": 0.06760057806968689,
      "pose_rmse_dtheta": 0.4997860789299011,
      "pose_rmse_dx": 0.2398034632205963,
      "pose_rmse_dy": 0.16439227759838104,
      "pose_rmse_mean": 0.30132728815078735,
      "rmse_dtheta": 0.05020340159535408,
      "rmse_dx": 0.02233843505382538,
      "rmse_dy": 0.00932584423571825,
      "rmse_mean": 0.02728922665119171,
      "rotation_flip": 0.008547008968889713,
      "sparse_tokens": 15928.0,
      "step": 1963,
      "turn_loss": 0.25460997223854065,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.09124698011522021,
      "grad_norm": 0.5826069116592407,
      "learning_rate": 9.417837825735613e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.031733475625514984,
      "mae_dx": 0.008775902912020683,
      "mae_dy": 0.0027875166852027178,
      "pose_mae_dtheta": 0.24566011130809784,
      "pose_mae_dx": 0.07167606800794601,
      "pose_mae_dy": 0.03241538628935814,
      "pose_rmse_dtheta": 0.4693688750267029,
      "pose_rmse_dx": 0.1654364913702011,
      "pose_rmse_dy": 0.07920791208744049,
      "pose_rmse_mean": 0.2380044311285019,
      "rmse_dtheta": 0.051203250885009766,
      "rmse_dx": 0.019863568246364594,
      "rmse_dy": 0.006542188581079245,
      "rmse_mean": 0.025869671255350113,
      "rotation_flip": 0.02144249528646469,
      "sparse_tokens": 9217.0,
      "step": 1964,
      "turn_loss": 0.22135303914546967,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.091293439881063,
      "grad_norm": 0.5913482308387756,
      "learning_rate": 9.417218471157646e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.04492049291729927,
      "mae_dx": 0.008439511992037296,
      "mae_dy": 0.004957785829901695,
      "pose_mae_dtheta": 0.37238505482673645,
      "pose_mae_dx": 0.06808159500360489,
      "pose_mae_dy": 0.06822259724140167,
      "pose_rmse_dtheta": 0.6713340878486633,
      "pose_rmse_dx": 0.1423753798007965,
      "pose_rmse_dy": 0.16457124054431915,
      "pose_rmse_mean": 0.3260935842990875,
      "rmse_dtheta": 0.06598610430955887,
      "rmse_dx": 0.018644090741872787,
      "rmse_dy": 0.009128393605351448,
      "rmse_mean": 0.03125286102294922,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 5277.0,
      "step": 1965,
      "turn_loss": 0.24514499306678772,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.09133989964690578,
      "grad_norm": 0.4519074857234955,
      "learning_rate": 9.416598807681221e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.015866857022047043,
      "mae_dx": 0.002163969911634922,
      "mae_dy": 0.002352737355977297,
      "pose_mae_dtheta": 0.10770364850759506,
      "pose_mae_dx": 0.0260930135846138,
      "pose_mae_dy": 0.03259945660829544,
      "pose_rmse_dtheta": 0.23755021393299103,
      "pose_rmse_dx": 0.05754552409052849,
      "pose_rmse_dy": 0.08200408518314362,
      "pose_rmse_mean": 0.1256999373435974,
      "rmse_dtheta": 0.030977055430412292,
      "rmse_dx": 0.006212287582457066,
      "rmse_dy": 0.004948592744767666,
      "rmse_mean": 0.014045978896319866,
      "rotation_flip": 0.009177680127322674,
      "sparse_tokens": 32137.0,
      "step": 1966,
      "turn_loss": 0.12796373665332794,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.09138635941274856,
      "grad_norm": 0.5546248555183411,
      "learning_rate": 9.41597883534967e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.012192615307867527,
      "mae_dx": 0.002843448892235756,
      "mae_dy": 0.003080932190641761,
      "pose_mae_dtheta": 0.09130313247442245,
      "pose_mae_dx": 0.023634184151887894,
      "pose_mae_dy": 0.026521766558289528,
      "pose_rmse_dtheta": 0.2406977117061615,
      "pose_rmse_dx": 0.06752253323793411,
      "pose_rmse_dy": 0.07472892850637436,
      "pose_rmse_mean": 0.12764972448349,
      "rmse_dtheta": 0.028810156509280205,
      "rmse_dx": 0.008389635942876339,
      "rmse_dy": 0.008876192383468151,
      "rmse_mean": 0.015358662232756615,
      "rotation_flip": 0.007462686393409967,
      "sparse_tokens": 32137.0,
      "step": 1967,
      "turn_loss": 0.11978159099817276,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.09143281917859133,
      "grad_norm": 0.48654961585998535,
      "learning_rate": 9.415358554206349e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.008302777074277401,
      "mae_dx": 0.0020431443117558956,
      "mae_dy": 0.0006472153472714126,
      "pose_mae_dtheta": 0.05826805531978607,
      "pose_mae_dx": 0.01745530404150486,
      "pose_mae_dy": 0.008288883604109287,
      "pose_rmse_dtheta": 0.22659893333911896,
      "pose_rmse_dx": 0.04534507915377617,
      "pose_rmse_dy": 0.022885125130414963,
      "pose_rmse_mean": 0.09827637672424316,
      "rmse_dtheta": 0.027501055970788002,
      "rmse_dx": 0.005748889409005642,
      "rmse_dy": 0.001982226502150297,
      "rmse_mean": 0.011744057759642601,
      "rotation_flip": 0.003919372800737619,
      "sparse_tokens": 32217.0,
      "step": 1968,
      "turn_loss": 0.061431337147951126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23943.0,
      "epoch": 0.09147927894443413,
      "grad_norm": 0.6590754389762878,
      "learning_rate": 9.414737964294636e-06,
      "loss": 0.1477,
      "mae_dtheta": 0.03510028123855591,
      "mae_dx": 0.010866597294807434,
      "mae_dy": 0.004574371501803398,
      "pose_mae_dtheta": 0.28440433740615845,
      "pose_mae_dx": 0.08371074497699738,
      "pose_mae_dy": 0.058950524777173996,
      "pose_rmse_dtheta": 0.5146926641464233,
      "pose_rmse_dx": 0.19666336476802826,
      "pose_rmse_dy": 0.1290290206670761,
      "pose_rmse_mean": 0.2801283597946167,
      "rmse_dtheta": 0.05540858209133148,
      "rmse_dx": 0.02325543947517872,
      "rmse_dy": 0.008570523001253605,
      "rmse_mean": 0.029078181833028793,
      "rotation_flip": 0.017699114978313446,
      "sparse_tokens": 18236.0,
      "step": 1969,
      "turn_loss": 0.2285810112953186,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0915257387102769,
      "grad_norm": 0.32275527715682983,
      "learning_rate": 9.414117065657927e-06,
      "loss": 0.0878,
      "mae_dtheta": 0.010108707472682,
      "mae_dx": 0.001765872468240559,
      "mae_dy": 0.0022606702987104654,
      "pose_mae_dtheta": 0.07311099767684937,
      "pose_mae_dx": 0.02485690638422966,
      "pose_mae_dy": 0.028155796229839325,
      "pose_rmse_dtheta": 0.20085279643535614,
      "pose_rmse_dx": 0.0726667046546936,
      "pose_rmse_dy": 0.0787186473608017,
      "pose_rmse_mean": 0.11741273105144501,
      "rmse_dtheta": 0.024423452094197273,
      "rmse_dx": 0.0048725055530667305,
      "rmse_dy": 0.005450943950563669,
      "rmse_mean": 0.011582301929593086,
      "rotation_flip": 0.004056795034557581,
      "sparse_tokens": 32121.0,
      "step": 1970,
      "turn_loss": 0.07012052088975906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30494.0,
      "epoch": 0.09157219847611968,
      "grad_norm": 0.37691065669059753,
      "learning_rate": 9.413495858339641e-06,
      "loss": 0.1111,
      "mae_dtheta": 0.0300891250371933,
      "mae_dx": 0.011321887373924255,
      "mae_dy": 0.004949530586600304,
      "pose_mae_dtheta": 0.22088037431240082,
      "pose_mae_dx": 0.08350417017936707,
      "pose_mae_dy": 0.07367453724145889,
      "pose_rmse_dtheta": 0.3899468779563904,
      "pose_rmse_dx": 0.2092464417219162,
      "pose_rmse_dy": 0.1531507521867752,
      "pose_rmse_mean": 0.2507813572883606,
      "rmse_dtheta": 0.0460708849132061,
      "rmse_dx": 0.024998188018798828,
      "rmse_dy": 0.008749070577323437,
      "rmse_mean": 0.02660604938864708,
      "rotation_flip": 0.013858497142791748,
      "sparse_tokens": 25065.0,
      "step": 1971,
      "turn_loss": 0.24119645357131958,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.09161865824196246,
      "grad_norm": 0.43415987491607666,
      "learning_rate": 9.412874342383221e-06,
      "loss": 0.1005,
      "mae_dtheta": 0.013836052268743515,
      "mae_dx": 0.003291411092504859,
      "mae_dy": 0.004212227649986744,
      "pose_mae_dtheta": 0.09107879549264908,
      "pose_mae_dx": 0.03270252048969269,
      "pose_mae_dy": 0.04199979454278946,
      "pose_rmse_dtheta": 0.19298119843006134,
      "pose_rmse_dx": 0.07293832302093506,
      "pose_rmse_dy": 0.08903781324625015,
      "pose_rmse_mean": 0.11831910908222198,
      "rmse_dtheta": 0.026472967118024826,
      "rmse_dx": 0.008788660168647766,
      "rmse_dy": 0.008518948219716549,
      "rmse_mean": 0.014593525789678097,
      "rotation_flip": 0.009545020759105682,
      "sparse_tokens": 32137.0,
      "step": 1972,
      "turn_loss": 0.13380441069602966,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.09166511800780525,
      "grad_norm": 0.7064226865768433,
      "learning_rate": 9.41225251783213e-06,
      "loss": 0.1903,
      "mae_dtheta": 0.04347005859017372,
      "mae_dx": 0.013121935538947582,
      "mae_dy": 0.00964905135333538,
      "pose_mae_dtheta": 0.3557378649711609,
      "pose_mae_dx": 0.12797175347805023,
      "pose_mae_dy": 0.07498623430728912,
      "pose_rmse_dtheta": 0.5885325074195862,
      "pose_rmse_dx": 0.24639354646205902,
      "pose_rmse_dy": 0.17494499683380127,
      "pose_rmse_mean": 0.3366236686706543,
      "rmse_dtheta": 0.06242755427956581,
      "rmse_dx": 0.022950921207666397,
      "rmse_dy": 0.02155202440917492,
      "rmse_mean": 0.035643503069877625,
      "rotation_flip": 0.018292682245373726,
      "sparse_tokens": 13623.0,
      "step": 1973,
      "turn_loss": 0.5019720196723938,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.09171157777364802,
      "grad_norm": 0.3636568784713745,
      "learning_rate": 9.411630384729853e-06,
      "loss": 0.0834,
      "mae_dtheta": 0.009371938183903694,
      "mae_dx": 0.001388109172694385,
      "mae_dy": 0.0021937924902886152,
      "pose_mae_dtheta": 0.06367743760347366,
      "pose_mae_dx": 0.018931962549686432,
      "pose_mae_dy": 0.029951579868793488,
      "pose_rmse_dtheta": 0.13530133664608002,
      "pose_rmse_dx": 0.05155528709292412,
      "pose_rmse_dy": 0.08258169889450073,
      "pose_rmse_mean": 0.08981277793645859,
      "rmse_dtheta": 0.018224216997623444,
      "rmse_dx": 0.0043363990262150764,
      "rmse_dy": 0.004538916517049074,
      "rmse_mean": 0.00903317704796791,
      "rotation_flip": 0.005095541477203369,
      "sparse_tokens": 32057.0,
      "step": 1974,
      "turn_loss": 0.07795511931180954,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0917580375394908,
      "grad_norm": 0.5223119258880615,
      "learning_rate": 9.411007943119895e-06,
      "loss": 0.1861,
      "mae_dtheta": 0.014981752261519432,
      "mae_dx": 0.0025650011375546455,
      "mae_dy": 0.004163503181189299,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5223118662834167,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 146.8564910888672,
      "model/head/act_norm_mean": 103.97993607954545,
      "model/head/act_norm_min": 48.541465759277344,
      "model/head/act_over_embed": 71.45598554936257,
      "model/head/grad_frac": 0.11776159703731537,
      "model/head/grad_norm": 0.06150827929377556,
      "model/head/grad_zero_frac": 0.00020178484555799514,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6923877446338383,
      "model/head/update_ratio": 0.0010670032352209091,
      "model/head/weight_delta": 5.075180530548096,
      "model/head/weight_delta_rel": 0.08903370052576065,
      "model/head/weight_norm": 57.64582443237305,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4143296778202057,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41427895386294544,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41419535875320435,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2846963756352896,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09721240401268005,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0507751926779747,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5360311792986425,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016509302658960223,
      "model/modality_embedder.encoders.pose/weight_delta": 1.6526622772216797,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05399762839078903,
      "model/modality_embedder.encoders.pose/weight_norm": 30.755504608154297,
      "model/modality_embedder/grad_frac": 0.09721240401268005,
      "model/modality_embedder/grad_norm": 0.0507751926779747,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5360311792986425,
      "model/modality_embedder/update_ratio": 0.0016509302658960223,
      "model/modality_embedder/weight_delta": 1.6526622772216797,
      "model/modality_embedder/weight_delta_rel": 0.05399762839078903,
      "model/modality_embedder/weight_norm": 30.755504608154297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.91334533691406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.90826168430335,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.080927848815918,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.74277189997819,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09358908236026764,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04888268932700157,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017711647087708116,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 0.995003879070282,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03625854104757309,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.599178314208984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.68985748291016,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.971029741863074,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.190834045410156,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.473116058924546,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09162880480289459,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04785881191492081,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016413818811997771,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.2387595176696777,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.042911596596241,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.157634735107422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.57522583007812,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.949124178290845,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.219738006591797,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.8324810748496,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09244765341281891,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04828650504350662,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001604689285159111,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.3187079429626465,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04427974298596382,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.09087562561035,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.4911880493164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.927972683181018,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.185968399047852,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.192364293681717,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08531887084245682,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04456305876374245,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015113804256543517,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.1265110969543457,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03849880397319794,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.485004425048828,
      "model/normalizer/grad_frac": 0.3268398344516754,
      "model/normalizer/grad_norm": 0.17071232199668884,
      "model/normalizer/grad_zero_frac": 0.0002068042231258005,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021895228419452906,
      "model/normalizer/weight_delta": 2.409069061279297,
      "model/normalizer/weight_delta_rel": 0.0310274139046669,
      "model/normalizer/weight_norm": 77.96781921386719,
      "pose_mae_dtheta": 0.10305614024400711,
      "pose_mae_dx": 0.03814277797937393,
      "pose_mae_dy": 0.05094002187252045,
      "pose_rmse_dtheta": 0.21534380316734314,
      "pose_rmse_dx": 0.09370514005422592,
      "pose_rmse_dy": 0.11110613495111465,
      "pose_rmse_mean": 0.1400516927242279,
      "rmse_dtheta": 0.027798375114798546,
      "rmse_dx": 0.007400838658213615,
      "rmse_dy": 0.00841261725872755,
      "rmse_mean": 0.01453727763146162,
      "rotation_flip": 0.00895316805690527,
      "sparse_tokens": 32089.0,
      "step": 1975,
      "turn_loss": 0.13693320751190186,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27903.0,
      "epoch": 0.09180449730533358,
      "grad_norm": 0.43013837933540344,
      "learning_rate": 9.410385193045783e-06,
      "loss": 0.1293,
      "mae_dtheta": 0.031268246471881866,
      "mae_dx": 0.013673903420567513,
      "mae_dy": 0.008096767589449883,
      "pose_mae_dtheta": 0.2254229635000229,
      "pose_mae_dx": 0.1198614165186882,
      "pose_mae_dy": 0.08569061011075974,
      "pose_rmse_dtheta": 0.3787917196750641,
      "pose_rmse_dx": 0.24988660216331482,
      "pose_rmse_dy": 0.17312683165073395,
      "pose_rmse_mean": 0.2672683894634247,
      "rmse_dtheta": 0.04699630290269852,
      "rmse_dx": 0.026393871754407883,
      "rmse_dy": 0.014900441281497478,
      "rmse_mean": 0.029430203139781952,
      "rotation_flip": 0.01328125037252903,
      "sparse_tokens": 22906.0,
      "step": 1976,
      "turn_loss": 0.3188621699810028,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09185095707117637,
      "grad_norm": 0.5297706723213196,
      "learning_rate": 9.409762134551069e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.013667683117091656,
      "mae_dx": 0.002777331741526723,
      "mae_dy": 0.0029450098518282175,
      "pose_mae_dtheta": 0.10088472813367844,
      "pose_mae_dx": 0.03456268087029457,
      "pose_mae_dy": 0.04467488080263138,
      "pose_rmse_dtheta": 0.19443237781524658,
      "pose_rmse_dx": 0.07843293249607086,
      "pose_rmse_dy": 0.09737756103277206,
      "pose_rmse_mean": 0.1234142929315567,
      "rmse_dtheta": 0.025917604565620422,
      "rmse_dx": 0.008361468091607094,
      "rmse_dy": 0.005723720882087946,
      "rmse_mean": 0.013334264978766441,
      "rotation_flip": 0.002364997984841466,
      "sparse_tokens": 32073.0,
      "step": 1977,
      "turn_loss": 0.12920145690441132,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.09189741683701914,
      "grad_norm": 0.6978206038475037,
      "learning_rate": 9.40913876767932e-06,
      "loss": 0.144,
      "mae_dtheta": 0.05416923388838768,
      "mae_dx": 0.019631478935480118,
      "mae_dy": 0.004061071667820215,
      "pose_mae_dtheta": 0.5143749117851257,
      "pose_mae_dx": 0.1662127524614334,
      "pose_mae_dy": 0.058189403265714645,
      "pose_rmse_dtheta": 0.7703161835670471,
      "pose_rmse_dx": 0.3314143717288971,
      "pose_rmse_dy": 0.1455722451210022,
      "pose_rmse_mean": 0.4157676100730896,
      "rmse_dtheta": 0.07146637886762619,
      "rmse_dx": 0.03446432203054428,
      "rmse_dy": 0.007684363517910242,
      "rmse_mean": 0.03787168860435486,
      "rotation_flip": 0.008474576286971569,
      "sparse_tokens": 5510.0,
      "step": 1978,
      "turn_loss": 0.3737143278121948,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.09194387660286192,
      "grad_norm": 0.7365363836288452,
      "learning_rate": 9.408515092474132e-06,
      "loss": 0.1389,
      "mae_dtheta": 0.009719056077301502,
      "mae_dx": 0.0018785971915349364,
      "mae_dy": 0.0010542748495936394,
      "pose_mae_dtheta": 0.07304725050926208,
      "pose_mae_dx": 0.02023894339799881,
      "pose_mae_dy": 0.016890237107872963,
      "pose_rmse_dtheta": 0.2252250462770462,
      "pose_rmse_dx": 0.04880696162581444,
      "pose_rmse_dy": 0.05397379398345947,
      "pose_rmse_mean": 0.1093352660536766,
      "rmse_dtheta": 0.02708534523844719,
      "rmse_dx": 0.005648170597851276,
      "rmse_dy": 0.0024576380383223295,
      "rmse_mean": 0.011730384081602097,
      "rotation_flip": 0.0026785715017467737,
      "sparse_tokens": 32185.0,
      "step": 1979,
      "turn_loss": 0.07384325563907623,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.0919903363687047,
      "grad_norm": 0.47014614939689636,
      "learning_rate": 9.407891108979117e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.01313380803912878,
      "mae_dx": 0.0017376121832057834,
      "mae_dy": 0.0033297117333859205,
      "pose_mae_dtheta": 0.08843396604061127,
      "pose_mae_dx": 0.0288238488137722,
      "pose_mae_dy": 0.03991703316569328,
      "pose_rmse_dtheta": 0.19619427621364594,
      "pose_rmse_dx": 0.07356147468090057,
      "pose_rmse_dy": 0.08652450889348984,
      "pose_rmse_mean": 0.11876009404659271,
      "rmse_dtheta": 0.02525205910205841,
      "rmse_dx": 0.004802483133971691,
      "rmse_dy": 0.006885609123855829,
      "rmse_mean": 0.01231338456273079,
      "rotation_flip": 0.00634328369051218,
      "sparse_tokens": 32057.0,
      "step": 1980,
      "turn_loss": 0.10421992093324661,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.09203679613454749,
      "grad_norm": 1.1832153797149658,
      "learning_rate": 9.40726681723791e-06,
      "loss": 0.2674,
      "mae_dtheta": 0.042821548879146576,
      "mae_dx": 0.018239356577396393,
      "mae_dy": 0.00667510787025094,
      "pose_mae_dtheta": 0.38523268699645996,
      "pose_mae_dx": 0.16346752643585205,
      "pose_mae_dy": 0.11472167819738388,
      "pose_rmse_dtheta": 0.6228752136230469,
      "pose_rmse_dx": 0.34364575147628784,
      "pose_rmse_dy": 0.22736184298992157,
      "pose_rmse_mean": 0.39796096086502075,
      "rmse_dtheta": 0.06041355058550835,
      "rmse_dx": 0.033237017691135406,
      "rmse_dy": 0.01191945280879736,
      "rmse_mean": 0.03519000858068466,
      "rotation_flip": 0.012658228166401386,
      "sparse_tokens": 12563.0,
      "step": 1981,
      "turn_loss": 0.37955567240715027,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.09208325590039027,
      "grad_norm": 0.6039538979530334,
      "learning_rate": 9.40664221729417e-06,
      "loss": 0.1628,
      "mae_dtheta": 0.015774937346577644,
      "mae_dx": 0.004039420280605555,
      "mae_dy": 0.005571958143264055,
      "pose_mae_dtheta": 0.11041708290576935,
      "pose_mae_dx": 0.04174754396080971,
      "pose_mae_dy": 0.04704447090625763,
      "pose_rmse_dtheta": 0.23196926712989807,
      "pose_rmse_dx": 0.10231480747461319,
      "pose_rmse_dy": 0.09579848498106003,
      "pose_rmse_mean": 0.14336085319519043,
      "rmse_dtheta": 0.029428720474243164,
      "rmse_dx": 0.009892047382891178,
      "rmse_dy": 0.011479652486741543,
      "rmse_mean": 0.01693347468972206,
      "rotation_flip": 0.01013734471052885,
      "sparse_tokens": 32137.0,
      "step": 1982,
      "turn_loss": 0.16658610105514526,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.09212971566623304,
      "grad_norm": 0.491142213344574,
      "learning_rate": 9.406017309191575e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.041806209832429886,
      "mae_dx": 0.010803280398249626,
      "mae_dy": 0.006945341359823942,
      "pose_mae_dtheta": 0.3652969002723694,
      "pose_mae_dx": 0.10528595000505447,
      "pose_mae_dy": 0.09176446497440338,
      "pose_rmse_dtheta": 0.6401796340942383,
      "pose_rmse_dx": 0.23492762446403503,
      "pose_rmse_dy": 0.21355238556861877,
      "pose_rmse_mean": 0.36288654804229736,
      "rmse_dtheta": 0.06400153785943985,
      "rmse_dx": 0.023677410557866096,
      "rmse_dy": 0.012904911302030087,
      "rmse_mean": 0.033527955412864685,
      "rotation_flip": 0.016339870169758797,
      "sparse_tokens": 5280.0,
      "step": 1983,
      "turn_loss": 0.2524681091308594,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.09217617543207582,
      "grad_norm": 0.6381432414054871,
      "learning_rate": 9.405392092973824e-06,
      "loss": 0.1986,
      "mae_dtheta": 0.045484837144613266,
      "mae_dx": 0.011068143881857395,
      "mae_dy": 0.0022026975639164448,
      "pose_mae_dtheta": 0.36891770362854004,
      "pose_mae_dx": 0.09830088168382645,
      "pose_mae_dy": 0.022271888330578804,
      "pose_rmse_dtheta": 0.616128146648407,
      "pose_rmse_dx": 0.23497994244098663,
      "pose_rmse_dy": 0.05278440937399864,
      "pose_rmse_mean": 0.30129748582839966,
      "rmse_dtheta": 0.06469279527664185,
      "rmse_dx": 0.023283185437321663,
      "rmse_dy": 0.005041887983679771,
      "rmse_mean": 0.03100595623254776,
      "rotation_flip": 0.014464802108705044,
      "sparse_tokens": 17748.0,
      "step": 1984,
      "turn_loss": 0.315635621547699,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 29108.0,
      "epoch": 0.09222263519791861,
      "grad_norm": 0.8774852156639099,
      "learning_rate": 9.40476656868464e-06,
      "loss": 0.1662,
      "mae_dtheta": 0.031117158010601997,
      "mae_dx": 0.011853148229420185,
      "mae_dy": 0.004361929837614298,
      "pose_mae_dtheta": 0.23840424418449402,
      "pose_mae_dx": 0.10265234112739563,
      "pose_mae_dy": 0.058418355882167816,
      "pose_rmse_dtheta": 0.45282691717147827,
      "pose_rmse_dx": 0.22685614228248596,
      "pose_rmse_dy": 0.17031168937683105,
      "pose_rmse_mean": 0.28333160281181335,
      "rmse_dtheta": 0.0512622632086277,
      "rmse_dx": 0.025035174563527107,
      "rmse_dy": 0.010795844718813896,
      "rmse_mean": 0.029031096026301384,
      "rotation_flip": 0.015458936803042889,
      "sparse_tokens": 24723.0,
      "step": 1985,
      "turn_loss": 0.23315569758415222,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.09226909496376139,
      "grad_norm": 0.7206932306289673,
      "learning_rate": 9.404140736367764e-06,
      "loss": 0.1444,
      "mae_dtheta": 0.03287908434867859,
      "mae_dx": 0.011767321266233921,
      "mae_dy": 0.003456904785707593,
      "pose_mae_dtheta": 0.26948076486587524,
      "pose_mae_dx": 0.10000570863485336,
      "pose_mae_dy": 0.04320153594017029,
      "pose_rmse_dtheta": 0.5116181373596191,
      "pose_rmse_dx": 0.23233111202716827,
      "pose_rmse_dy": 0.10663169622421265,
      "pose_rmse_mean": 0.2835269868373871,
      "rmse_dtheta": 0.05452815443277359,
      "rmse_dx": 0.024614805355668068,
      "rmse_dy": 0.008637257851660252,
      "rmse_mean": 0.029260072857141495,
      "rotation_flip": 0.007272727321833372,
      "sparse_tokens": 14872.0,
      "step": 1986,
      "turn_loss": 0.22121883928775787,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.09231555472960416,
      "grad_norm": 0.48696741461753845,
      "learning_rate": 9.403514596066964e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.03801925852894783,
      "mae_dx": 0.01052673440426588,
      "mae_dy": 0.004965293221175671,
      "pose_mae_dtheta": 0.3205680847167969,
      "pose_mae_dx": 0.09379921853542328,
      "pose_mae_dy": 0.049690794199705124,
      "pose_rmse_dtheta": 0.5736588835716248,
      "pose_rmse_dx": 0.22221025824546814,
      "pose_rmse_dy": 0.1221785843372345,
      "pose_rmse_mean": 0.30601590871810913,
      "rmse_dtheta": 0.05748612806200981,
      "rmse_dx": 0.022760337218642235,
      "rmse_dy": 0.01039903238415718,
      "rmse_mean": 0.03021516464650631,
      "rotation_flip": 0.00933125987648964,
      "sparse_tokens": 9596.0,
      "step": 1987,
      "turn_loss": 0.29210716485977173,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.09236201449544694,
      "grad_norm": 0.370491087436676,
      "learning_rate": 9.402888147826023e-06,
      "loss": 0.0943,
      "mae_dtheta": 0.008965629152953625,
      "mae_dx": 0.002456589601933956,
      "mae_dy": 0.003216343931853771,
      "pose_mae_dtheta": 0.06074736639857292,
      "pose_mae_dx": 0.027559129521250725,
      "pose_mae_dy": 0.030232002958655357,
      "pose_rmse_dtheta": 0.11544500291347504,
      "pose_rmse_dx": 0.0723813846707344,
      "pose_rmse_dy": 0.07324935495853424,
      "pose_rmse_mean": 0.0870252475142479,
      "rmse_dtheta": 0.017943931743502617,
      "rmse_dx": 0.006868286523967981,
      "rmse_dy": 0.00779502559453249,
      "rmse_mean": 0.010869081132113934,
      "rotation_flip": 0.004649360664188862,
      "sparse_tokens": 32105.0,
      "step": 1988,
      "turn_loss": 0.09919731318950653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.09240847426128972,
      "grad_norm": 0.7056944966316223,
      "learning_rate": 9.402261391688755e-06,
      "loss": 0.1843,
      "mae_dtheta": 0.006827317178249359,
      "mae_dx": 0.0021538774017244577,
      "mae_dy": 0.00041893619345501065,
      "pose_mae_dtheta": 0.05015569180250168,
      "pose_mae_dx": 0.018036924302577972,
      "pose_mae_dy": 0.005771053954958916,
      "pose_rmse_dtheta": 0.16119781136512756,
      "pose_rmse_dx": 0.0404856838285923,
      "pose_rmse_dy": 0.013387078419327736,
      "pose_rmse_mean": 0.07169019430875778,
      "rmse_dtheta": 0.022494589909911156,
      "rmse_dx": 0.005461027380079031,
      "rmse_dy": 0.000994732603430748,
      "rmse_mean": 0.00965011678636074,
      "rotation_flip": 0.005138086155056953,
      "sparse_tokens": 32217.0,
      "step": 1989,
      "turn_loss": 0.05300334095954895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.09245493402713251,
      "grad_norm": 1.0446209907531738,
      "learning_rate": 9.401634327698981e-06,
      "loss": 0.3412,
      "mae_dtheta": 0.029062164947390556,
      "mae_dx": 0.015713436529040337,
      "mae_dy": 0.00357938464730978,
      "pose_mae_dtheta": 0.22821521759033203,
      "pose_mae_dx": 0.11883170902729034,
      "pose_mae_dy": 0.06080970540642738,
      "pose_rmse_dtheta": 0.34070461988449097,
      "pose_rmse_dx": 0.24101172387599945,
      "pose_rmse_dy": 0.14083176851272583,
      "pose_rmse_mean": 0.24084937572479248,
      "rmse_dtheta": 0.04049345850944519,
      "rmse_dx": 0.028995292261242867,
      "rmse_dy": 0.006739192176610231,
      "rmse_mean": 0.025409314781427383,
      "rotation_flip": 0.01923076994717121,
      "sparse_tokens": 4925.0,
      "step": 1990,
      "turn_loss": 0.34910938143730164,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.09250139379297528,
      "grad_norm": 0.7081298232078552,
      "learning_rate": 9.401006955900555e-06,
      "loss": 0.1436,
      "mae_dtheta": 0.039347272366285324,
      "mae_dx": 0.007797927595674992,
      "mae_dy": 0.009723366238176823,
      "pose_mae_dtheta": 0.2759115993976593,
      "pose_mae_dx": 0.06202635169029236,
      "pose_mae_dy": 0.12177416682243347,
      "pose_rmse_dtheta": 0.4805980622768402,
      "pose_rmse_dx": 0.12389004975557327,
      "pose_rmse_dy": 0.2648486793041229,
      "pose_rmse_mean": 0.2897789478302002,
      "rmse_dtheta": 0.05820426344871521,
      "rmse_dx": 0.017655670642852783,
      "rmse_dy": 0.020220432430505753,
      "rmse_mean": 0.03202679008245468,
      "rotation_flip": 0.01955307275056839,
      "sparse_tokens": 5662.0,
      "step": 1991,
      "turn_loss": 0.29612618684768677,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.09254785355881806,
      "grad_norm": 0.7512552738189697,
      "learning_rate": 9.400379276337355e-06,
      "loss": 0.1269,
      "mae_dtheta": 0.02097119577229023,
      "mae_dx": 0.007876817137002945,
      "mae_dy": 0.0038357130251824856,
      "pose_mae_dtheta": 0.17119009792804718,
      "pose_mae_dx": 0.06897859275341034,
      "pose_mae_dy": 0.05406390503048897,
      "pose_rmse_dtheta": 0.30329275131225586,
      "pose_rmse_dx": 0.16636918485164642,
      "pose_rmse_dy": 0.11769863218069077,
      "pose_rmse_mean": 0.19578686356544495,
      "rmse_dtheta": 0.034640971571207047,
      "rmse_dx": 0.018521616235375404,
      "rmse_dy": 0.0068763019517064095,
      "rmse_mean": 0.02001296356320381,
      "rotation_flip": 0.015594542026519775,
      "sparse_tokens": 10492.0,
      "step": 1992,
      "turn_loss": 0.18637411296367645,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09259431332466084,
      "grad_norm": 0.5538002848625183,
      "learning_rate": 9.399751289053267e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.013816939666867256,
      "mae_dx": 0.0019744334276765585,
      "mae_dy": 0.0027973519172519445,
      "pose_mae_dtheta": 0.09495126456022263,
      "pose_mae_dx": 0.025056350976228714,
      "pose_mae_dy": 0.03702162578701973,
      "pose_rmse_dtheta": 0.2314910739660263,
      "pose_rmse_dx": 0.056332334876060486,
      "pose_rmse_dy": 0.08034855872392654,
      "pose_rmse_mean": 0.12272398918867111,
      "rmse_dtheta": 0.029501430690288544,
      "rmse_dx": 0.0055135758593678474,
      "rmse_dy": 0.005861013196408749,
      "rmse_mean": 0.013625340536236763,
      "rotation_flip": 0.005341002251952887,
      "sparse_tokens": 32089.0,
      "step": 1993,
      "turn_loss": 0.09408681839704514,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.09264077309050363,
      "grad_norm": 0.6322464942932129,
      "learning_rate": 9.39912299409221e-06,
      "loss": 0.1397,
      "mae_dtheta": 0.02662568725645542,
      "mae_dx": 0.01016227062791586,
      "mae_dy": 0.00564796244725585,
      "pose_mae_dtheta": 0.20906613767147064,
      "pose_mae_dx": 0.07668209820985794,
      "pose_mae_dy": 0.06872650980949402,
      "pose_rmse_dtheta": 0.3639698326587677,
      "pose_rmse_dx": 0.1729660928249359,
      "pose_rmse_dy": 0.15385785698890686,
      "pose_rmse_mean": 0.2302645891904831,
      "rmse_dtheta": 0.041454631835222244,
      "rmse_dx": 0.02246825583279133,
      "rmse_dy": 0.010199818760156631,
      "rmse_mean": 0.024707570672035217,
      "rotation_flip": 0.014072119258344173,
      "sparse_tokens": 21240.0,
      "step": 1994,
      "turn_loss": 0.23578576743602753,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.0926872328563464,
      "grad_norm": 0.6488577127456665,
      "learning_rate": 9.398494391498122e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.04370274394750595,
      "mae_dx": 0.013921127654612064,
      "mae_dy": 0.005984710529446602,
      "pose_mae_dtheta": 0.36135727167129517,
      "pose_mae_dx": 0.0949246808886528,
      "pose_mae_dy": 0.0691312700510025,
      "pose_rmse_dtheta": 0.584126889705658,
      "pose_rmse_dx": 0.197487011551857,
      "pose_rmse_dy": 0.1404472142457962,
      "pose_rmse_mean": 0.3073537051677704,
      "rmse_dtheta": 0.05989504233002663,
      "rmse_dx": 0.02555694989860058,
      "rmse_dy": 0.010363447479903698,
      "rmse_mean": 0.03193847835063934,
      "rotation_flip": 0.028625953942537308,
      "sparse_tokens": 8586.0,
      "step": 1995,
      "turn_loss": 0.30924519896507263,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 33634.0,
      "epoch": 0.09273369262218918,
      "grad_norm": 0.5870161652565002,
      "learning_rate": 9.397865481314959e-06,
      "loss": 0.1568,
      "mae_dtheta": 0.04029703140258789,
      "mae_dx": 0.01810687594115734,
      "mae_dy": 0.006571139674633741,
      "pose_mae_dtheta": 0.3577607572078705,
      "pose_mae_dx": 0.15436974167823792,
      "pose_mae_dy": 0.051646165549755096,
      "pose_rmse_dtheta": 0.5615502595901489,
      "pose_rmse_dx": 0.29608142375946045,
      "pose_rmse_dy": 0.12315826863050461,
      "pose_rmse_mean": 0.3269299864768982,
      "rmse_dtheta": 0.056700967252254486,
      "rmse_dx": 0.030699342489242554,
      "rmse_dy": 0.014485090970993042,
      "rmse_mean": 0.03396180272102356,
      "rotation_flip": 0.0117647061124444,
      "sparse_tokens": 26837.0,
      "step": 1996,
      "turn_loss": 0.34994152188301086,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.09278015238803196,
      "grad_norm": 0.6835401058197021,
      "learning_rate": 9.397236263586705e-06,
      "loss": 0.1326,
      "mae_dtheta": 0.037057094275951385,
      "mae_dx": 0.0130715137347579,
      "mae_dy": 0.005063376389443874,
      "pose_mae_dtheta": 0.3361195921897888,
      "pose_mae_dx": 0.10699914395809174,
      "pose_mae_dy": 0.057473551481962204,
      "pose_rmse_dtheta": 0.5722400546073914,
      "pose_rmse_dx": 0.22457516193389893,
      "pose_rmse_dy": 0.13608719408512115,
      "pose_rmse_mean": 0.31096747517585754,
      "rmse_dtheta": 0.0562204085290432,
      "rmse_dx": 0.02454804629087448,
      "rmse_dy": 0.010986238718032837,
      "rmse_mean": 0.030584897845983505,
      "rotation_flip": 0.017580144107341766,
      "sparse_tokens": 17944.0,
      "step": 1997,
      "turn_loss": 0.28306904435157776,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.09282661215387475,
      "grad_norm": 0.572359561920166,
      "learning_rate": 9.396606738357357e-06,
      "loss": 0.1662,
      "mae_dtheta": 0.03919545188546181,
      "mae_dx": 0.014549940824508667,
      "mae_dy": 0.00631263991817832,
      "pose_mae_dtheta": 0.30524325370788574,
      "pose_mae_dx": 0.11960066854953766,
      "pose_mae_dy": 0.06615418195724487,
      "pose_rmse_dtheta": 0.486267626285553,
      "pose_rmse_dx": 0.2484496533870697,
      "pose_rmse_dy": 0.15329450368881226,
      "pose_rmse_mean": 0.29600393772125244,
      "rmse_dtheta": 0.055631883442401886,
      "rmse_dx": 0.02684531733393669,
      "rmse_dy": 0.012933609075844288,
      "rmse_mean": 0.03180360421538353,
      "rotation_flip": 0.021321961656212807,
      "sparse_tokens": 21180.0,
      "step": 1998,
      "turn_loss": 0.3274056017398834,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.09287307191971753,
      "grad_norm": 0.6151984333992004,
      "learning_rate": 9.39597690567094e-06,
      "loss": 0.1777,
      "mae_dtheta": 0.024468861520290375,
      "mae_dx": 0.010605634190142155,
      "mae_dy": 0.005272268783301115,
      "pose_mae_dtheta": 0.17334526777267456,
      "pose_mae_dx": 0.08161013573408127,
      "pose_mae_dy": 0.07481028884649277,
      "pose_rmse_dtheta": 0.28801143169403076,
      "pose_rmse_dx": 0.21259240806102753,
      "pose_rmse_dy": 0.15318788588047028,
      "pose_rmse_mean": 0.21793058514595032,
      "rmse_dtheta": 0.03750510886311531,
      "rmse_dx": 0.023795904591679573,
      "rmse_dy": 0.010001098737120628,
      "rmse_mean": 0.023767372593283653,
      "rotation_flip": 0.01312335953116417,
      "sparse_tokens": 14352.0,
      "step": 1999,
      "turn_loss": 0.22499194741249084,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.0929195316855603,
      "grad_norm": 0.38797518610954285,
      "learning_rate": 9.395346765571499e-06,
      "loss": 0.1118,
      "mae_dtheta": 0.028138447552919388,
      "mae_dx": 0.01313797477632761,
      "mae_dy": 0.004080987069755793,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3879750967025757,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.35800170898438,
      "model/head/act_norm_mean": 112.2622302827381,
      "model/head/act_norm_min": 75.54154968261719,
      "model/head/act_over_embed": 77.14765566585655,
      "model/head/grad_frac": 0.13966146111488342,
      "model/head/grad_norm": 0.0541851669549942,
      "model/head/grad_zero_frac": 0.0001430895645171404,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.679656498015873,
      "model/head/update_ratio": 0.0009398441179655492,
      "model/head/weight_delta": 5.112561225891113,
      "model/head/weight_delta_rel": 0.0896894708275795,
      "model/head/weight_norm": 57.65335464477539,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4143550395965576,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41427990794181824,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41422638297080994,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2846970312872232,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10512508451938629,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04078591614961624,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.521942138671875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013260634150356054,
      "model/modality_embedder.encoders.pose/weight_delta": 1.6597504615783691,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05422922223806381,
      "model/modality_embedder.encoders.pose/weight_norm": 30.757139205932617,
      "model/modality_embedder/grad_frac": 0.10512508451938629,
      "model/modality_embedder/grad_norm": 0.04078591614961624,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.521942138671875,
      "model/modality_embedder/update_ratio": 0.0013260634150356054,
      "model/modality_embedder/weight_delta": 1.6597504615783691,
      "model/modality_embedder/weight_delta_rel": 0.05422922223806381,
      "model/modality_embedder/weight_norm": 30.757139205932617,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.0264892578125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.58149289808516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.021794319152832,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.205422692978974,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09527900069952011,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.036965880542993546,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013392826076596975,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.0064533948898315,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.036675769835710526,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.601255416870117,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.59883880615234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.48135944192492,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.476981163024902,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.823819406588974,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09600552916526794,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.037247754633426666,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012773163616657257,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.2532293796539307,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04341284558176994,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.160947799682617,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.28685760498047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.191533210506424,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.355789184570312,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.999066831257263,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09994255006313324,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03877522051334381,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012884503230452538,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.3329534530639648,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04475808143615723,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.094463348388672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.9166030883789,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.129867803602924,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.526775360107422,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.331108510607546,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09925572574138641,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03850875049829483,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013059197226539254,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.1392757892608643,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.038935039192438126,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.487838745117188,
      "model/normalizer/grad_frac": 0.34813427925109863,
      "model/normalizer/grad_norm": 0.1350674331188202,
      "model/normalizer/grad_zero_frac": 0.00017135207599494606,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017322663916274905,
      "model/normalizer/weight_delta": 2.436168670654297,
      "model/normalizer/weight_delta_rel": 0.031376443803310394,
      "model/normalizer/weight_norm": 77.97151184082031,
      "pose_mae_dtheta": 0.2117798626422882,
      "pose_mae_dx": 0.11028032004833221,
      "pose_mae_dy": 0.05968976020812988,
      "pose_rmse_dtheta": 0.39104920625686646,
      "pose_rmse_dx": 0.27597370743751526,
      "pose_rmse_dy": 0.1504349559545517,
      "pose_rmse_mean": 0.27248597145080566,
      "rmse_dtheta": 0.0448279082775116,
      "rmse_dx": 0.028250889852643013,
      "rmse_dy": 0.008447278290987015,
      "rmse_mean": 0.027175357565283775,
      "rotation_flip": 0.012195121496915817,
      "sparse_tokens": 16054.0,
      "step": 2000,
      "turn_loss": 0.2352161556482315,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "epoch": 0.0929195316855603,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.33154305815696716,
      "eval_objectnav_nopose_mae_dtheta": 0.04296117275953293,
      "eval_objectnav_nopose_mae_dx": 0.01509473379701376,
      "eval_objectnav_nopose_mae_dy": 0.004627378657460213,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.350339412689209,
      "eval_objectnav_nopose_pose_mae_dx": 0.125735804438591,
      "eval_objectnav_nopose_pose_mae_dy": 0.05508562922477722,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5718278884887695,
      "eval_objectnav_nopose_pose_rmse_dx": 0.26565325260162354,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12950550019741058,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3223288953304291,
      "eval_objectnav_nopose_rmse_dtheta": 0.060826849192380905,
      "eval_objectnav_nopose_rmse_dx": 0.028362825512886047,
      "eval_objectnav_nopose_rmse_dy": 0.009454690851271152,
      "eval_objectnav_nopose_rmse_mean": 0.03288145735859871,
      "eval_objectnav_nopose_rotation_flip": 0.014814097434282303,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.33154305815696716,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 2000
    },
    {
      "epoch": 0.0929195316855603,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2965995669364929,
      "eval_objectnav_pose_mae_dtheta": 0.038462236523628235,
      "eval_objectnav_pose_mae_dx": 0.012650546617805958,
      "eval_objectnav_pose_mae_dy": 0.0043843528255820274,
      "eval_objectnav_pose_pose_mae_dtheta": 0.30202847719192505,
      "eval_objectnav_pose_pose_mae_dx": 0.10291539877653122,
      "eval_objectnav_pose_pose_mae_dy": 0.04979073628783226,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5179287195205688,
      "eval_objectnav_pose_pose_rmse_dx": 0.22908522188663483,
      "eval_objectnav_pose_pose_rmse_dy": 0.1194700077176094,
      "eval_objectnav_pose_pose_rmse_mean": 0.2888279855251312,
      "eval_objectnav_pose_rmse_dtheta": 0.05661683529615402,
      "eval_objectnav_pose_rmse_dx": 0.02517431229352951,
      "eval_objectnav_pose_rmse_dy": 0.009182075038552284,
      "eval_objectnav_pose_rmse_mean": 0.030324406921863556,
      "eval_objectnav_pose_rotation_flip": 0.01438641082495451,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2965995669364929,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 2000
    },
    {
      "epoch": 0.0929195316855603,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10428561270236969,
      "eval_pointnav_mae_dtheta": 0.012371642515063286,
      "eval_pointnav_mae_dx": 0.003062611911445856,
      "eval_pointnav_mae_dy": 0.0028846145141869783,
      "eval_pointnav_pose_mae_dtheta": 0.08804988861083984,
      "eval_pointnav_pose_mae_dx": 0.034403685480356216,
      "eval_pointnav_pose_mae_dy": 0.03336338326334953,
      "eval_pointnav_pose_rmse_dtheta": 0.23086991906166077,
      "eval_pointnav_pose_rmse_dx": 0.09541741013526917,
      "eval_pointnav_pose_rmse_dy": 0.09396083652973175,
      "eval_pointnav_pose_rmse_mean": 0.1400827169418335,
      "eval_pointnav_rmse_dtheta": 0.02827870473265648,
      "eval_pointnav_rmse_dx": 0.008904867805540562,
      "eval_pointnav_rmse_dy": 0.007441893219947815,
      "eval_pointnav_rmse_mean": 0.014875154942274094,
      "eval_pointnav_rotation_flip": 0.0061474815011024475,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10428561270236969,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 2000
    },
    {
      "epoch": 0.0929195316855603,
      "eval_loss": 0.24414274593194327,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.33154305815696716,
      "eval_objectnav_nopose_mae_dtheta": 0.04296117275953293,
      "eval_objectnav_nopose_mae_dx": 0.01509473379701376,
      "eval_objectnav_nopose_mae_dy": 0.004627378657460213,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.350339412689209,
      "eval_objectnav_nopose_pose_mae_dx": 0.125735804438591,
      "eval_objectnav_nopose_pose_mae_dy": 0.05508562922477722,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5718278884887695,
      "eval_objectnav_nopose_pose_rmse_dx": 0.26565325260162354,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12950550019741058,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3223288953304291,
      "eval_objectnav_nopose_rmse_dtheta": 0.060826849192380905,
      "eval_objectnav_nopose_rmse_dx": 0.028362825512886047,
      "eval_objectnav_nopose_rmse_dy": 0.009454690851271152,
      "eval_objectnav_nopose_rmse_mean": 0.03288145735859871,
      "eval_objectnav_nopose_rotation_flip": 0.014814097434282303,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.33154305815696716,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2965995669364929,
      "eval_objectnav_pose_mae_dtheta": 0.038462236523628235,
      "eval_objectnav_pose_mae_dx": 0.012650546617805958,
      "eval_objectnav_pose_mae_dy": 0.0043843528255820274,
      "eval_objectnav_pose_pose_mae_dtheta": 0.30202847719192505,
      "eval_objectnav_pose_pose_mae_dx": 0.10291539877653122,
      "eval_objectnav_pose_pose_mae_dy": 0.04979073628783226,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5179287195205688,
      "eval_objectnav_pose_pose_rmse_dx": 0.22908522188663483,
      "eval_objectnav_pose_pose_rmse_dy": 0.1194700077176094,
      "eval_objectnav_pose_pose_rmse_mean": 0.2888279855251312,
      "eval_objectnav_pose_rmse_dtheta": 0.05661683529615402,
      "eval_objectnav_pose_rmse_dx": 0.02517431229352951,
      "eval_objectnav_pose_rmse_dy": 0.009182075038552284,
      "eval_objectnav_pose_rmse_mean": 0.030324406921863556,
      "eval_objectnav_pose_rotation_flip": 0.01438641082495451,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2965995669364929,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10428561270236969,
      "eval_pointnav_mae_dtheta": 0.012371642515063286,
      "eval_pointnav_mae_dx": 0.003062611911445856,
      "eval_pointnav_mae_dy": 0.0028846145141869783,
      "eval_pointnav_pose_mae_dtheta": 0.08804988861083984,
      "eval_pointnav_pose_mae_dx": 0.034403685480356216,
      "eval_pointnav_pose_mae_dy": 0.03336338326334953,
      "eval_pointnav_pose_rmse_dtheta": 0.23086991906166077,
      "eval_pointnav_pose_rmse_dx": 0.09541741013526917,
      "eval_pointnav_pose_rmse_dy": 0.09396083652973175,
      "eval_pointnav_pose_rmse_mean": 0.1400827169418335,
      "eval_pointnav_rmse_dtheta": 0.02827870473265648,
      "eval_pointnav_rmse_dx": 0.008904867805540562,
      "eval_pointnav_rmse_dy": 0.007441893219947815,
      "eval_pointnav_rmse_mean": 0.014875154942274094,
      "eval_pointnav_rotation_flip": 0.0061474815011024475,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10428561270236969,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 2000
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.09296599145140308,
      "grad_norm": 0.4717113673686981,
      "learning_rate": 9.394716318103098e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.009145165793597698,
      "mae_dx": 0.0018772215116769075,
      "mae_dy": 0.0017933808267116547,
      "pose_mae_dtheta": 0.060278989374637604,
      "pose_mae_dx": 0.02024185284972191,
      "pose_mae_dy": 0.02217857725918293,
      "pose_rmse_dtheta": 0.14073070883750916,
      "pose_rmse_dx": 0.052936311811208725,
      "pose_rmse_dy": 0.05208718404173851,
      "pose_rmse_mean": 0.08191807568073273,
      "rmse_dtheta": 0.021103763952851295,
      "rmse_dx": 0.006068374030292034,
      "rmse_dy": 0.004302886314690113,
      "rmse_mean": 0.010491674765944481,
      "rotation_flip": 0.004464285913854837,
      "sparse_tokens": 32137.0,
      "step": 2001,
      "turn_loss": 0.06894562393426895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.09301245121724587,
      "grad_norm": 0.4012521207332611,
      "learning_rate": 9.394085563309827e-06,
      "loss": 0.0754,
      "mae_dtheta": 0.032050248235464096,
      "mae_dx": 0.00868831668049097,
      "mae_dy": 0.0032100172247737646,
      "pose_mae_dtheta": 0.20602566003799438,
      "pose_mae_dx": 0.07323011010885239,
      "pose_mae_dy": 0.04056137055158615,
      "pose_rmse_dtheta": 0.3855953812599182,
      "pose_rmse_dx": 0.1542615443468094,
      "pose_rmse_dy": 0.08903845399618149,
      "pose_rmse_mean": 0.2096317857503891,
      "rmse_dtheta": 0.05034758895635605,
      "rmse_dx": 0.018807927146553993,
      "rmse_dy": 0.006703254766762257,
      "rmse_mean": 0.02528625726699829,
      "rotation_flip": 0.006644518114626408,
      "sparse_tokens": 10241.0,
      "step": 2002,
      "turn_loss": 0.24695122241973877,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.09305891098308865,
      "grad_norm": 0.7758230566978455,
      "learning_rate": 9.393454501235795e-06,
      "loss": 0.1829,
      "mae_dtheta": 0.03846261277794838,
      "mae_dx": 0.012938453815877438,
      "mae_dy": 0.0038671635556966066,
      "pose_mae_dtheta": 0.31547048687934875,
      "pose_mae_dx": 0.10026910156011581,
      "pose_mae_dy": 0.047600191086530685,
      "pose_rmse_dtheta": 0.5195071697235107,
      "pose_rmse_dx": 0.22410160303115845,
      "pose_rmse_dy": 0.1310686320066452,
      "pose_rmse_mean": 0.2915591597557068,
      "rmse_dtheta": 0.055908627808094025,
      "rmse_dx": 0.02542067877948284,
      "rmse_dy": 0.008168348111212254,
      "rmse_mean": 0.02983255311846733,
      "rotation_flip": 0.011727078817784786,
      "sparse_tokens": 16336.0,
      "step": 2003,
      "turn_loss": 0.29730719327926636,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.09310537074893142,
      "grad_norm": 0.5457556247711182,
      "learning_rate": 9.392823131925131e-06,
      "loss": 0.1269,
      "mae_dtheta": 0.03709615394473076,
      "mae_dx": 0.012529307045042515,
      "mae_dy": 0.006366043817251921,
      "pose_mae_dtheta": 0.31213444471359253,
      "pose_mae_dx": 0.09978098422288895,
      "pose_mae_dy": 0.07093816995620728,
      "pose_rmse_dtheta": 0.517478346824646,
      "pose_rmse_dx": 0.18800507485866547,
      "pose_rmse_dy": 0.1511748880147934,
      "pose_rmse_mean": 0.2855527997016907,
      "rmse_dtheta": 0.05519579350948334,
      "rmse_dx": 0.02443862333893776,
      "rmse_dy": 0.011726520024240017,
      "rmse_mean": 0.030453644692897797,
      "rotation_flip": 0.015384615398943424,
      "sparse_tokens": 9264.0,
      "step": 2004,
      "turn_loss": 0.321560263633728,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0931518305147742,
      "grad_norm": 0.6216209530830383,
      "learning_rate": 9.392191455421989e-06,
      "loss": 0.139,
      "mae_dtheta": 0.01597270928323269,
      "mae_dx": 0.002946077147498727,
      "mae_dy": 0.004867115058004856,
      "pose_mae_dtheta": 0.10549493134021759,
      "pose_mae_dx": 0.04677727818489075,
      "pose_mae_dy": 0.0515739805996418,
      "pose_rmse_dtheta": 0.21811001002788544,
      "pose_rmse_dx": 0.10616691410541534,
      "pose_rmse_dy": 0.11529569327831268,
      "pose_rmse_mean": 0.14652422070503235,
      "rmse_dtheta": 0.028308333829045296,
      "rmse_dx": 0.007174214813858271,
      "rmse_dy": 0.009518432430922985,
      "rmse_mean": 0.015000327490270138,
      "rotation_flip": 0.00992635264992714,
      "sparse_tokens": 32089.0,
      "step": 2005,
      "turn_loss": 0.1369621455669403,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.09319829028061699,
      "grad_norm": 0.5173113942146301,
      "learning_rate": 9.391559471770537e-06,
      "loss": 0.1244,
      "mae_dtheta": 0.04159878194332123,
      "mae_dx": 0.013416050001978874,
      "mae_dy": 0.012644014321267605,
      "pose_mae_dtheta": 0.26518481969833374,
      "pose_mae_dx": 0.10275458544492722,
      "pose_mae_dy": 0.13112063705921173,
      "pose_rmse_dtheta": 0.45090267062187195,
      "pose_rmse_dx": 0.22089502215385437,
      "pose_rmse_dy": 0.2470480054616928,
      "pose_rmse_mean": 0.3062819242477417,
      "rmse_dtheta": 0.0596221461892128,
      "rmse_dx": 0.026477167382836342,
      "rmse_dy": 0.021794473752379417,
      "rmse_mean": 0.03596459701657295,
      "rotation_flip": 0.011204482056200504,
      "sparse_tokens": 5408.0,
      "step": 2006,
      "turn_loss": 0.5137626528739929,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.09324475004645977,
      "grad_norm": 0.5373156666755676,
      "learning_rate": 9.390927181014978e-06,
      "loss": 0.0993,
      "mae_dtheta": 0.030424293130636215,
      "mae_dx": 0.011258923448622227,
      "mae_dy": 0.003286776365712285,
      "pose_mae_dtheta": 0.22785800695419312,
      "pose_mae_dx": 0.08744946122169495,
      "pose_mae_dy": 0.042508315294981,
      "pose_rmse_dtheta": 0.4271792769432068,
      "pose_rmse_dx": 0.2114233672618866,
      "pose_rmse_dy": 0.09443828463554382,
      "pose_rmse_mean": 0.2443469762802124,
      "rmse_dtheta": 0.04847683757543564,
      "rmse_dx": 0.023625848814845085,
      "rmse_dy": 0.006819271948188543,
      "rmse_mean": 0.026307320222258568,
      "rotation_flip": 0.006756756920367479,
      "sparse_tokens": 13569.0,
      "step": 2007,
      "turn_loss": 0.21065349876880646,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.09329120981230254,
      "grad_norm": 0.6174307465553284,
      "learning_rate": 9.390294583199524e-06,
      "loss": 0.1114,
      "mae_dtheta": 0.007928663864731789,
      "mae_dx": 0.0013604402774944901,
      "mae_dy": 0.0008499090326949954,
      "pose_mae_dtheta": 0.06279030442237854,
      "pose_mae_dx": 0.013880453072488308,
      "pose_mae_dy": 0.015688519924879074,
      "pose_rmse_dtheta": 0.23169228434562683,
      "pose_rmse_dx": 0.034956734627485275,
      "pose_rmse_dy": 0.03861885145306587,
      "pose_rmse_mean": 0.10175596177577972,
      "rmse_dtheta": 0.025586996227502823,
      "rmse_dx": 0.004378330893814564,
      "rmse_dy": 0.0016754885436967015,
      "rmse_mean": 0.010546939447522163,
      "rotation_flip": 0.0005945303128100932,
      "sparse_tokens": 32121.0,
      "step": 2008,
      "turn_loss": 0.04664940387010574,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09333766957814532,
      "grad_norm": 0.5034668445587158,
      "learning_rate": 9.389661678368412e-06,
      "loss": 0.1086,
      "mae_dtheta": 0.011938674375414848,
      "mae_dx": 0.00195465050637722,
      "mae_dy": 0.00285162846557796,
      "pose_mae_dtheta": 0.08093004673719406,
      "pose_mae_dx": 0.027195001021027565,
      "pose_mae_dy": 0.038388654589653015,
      "pose_rmse_dtheta": 0.19357796013355255,
      "pose_rmse_dx": 0.06532299518585205,
      "pose_rmse_dy": 0.11101629585027695,
      "pose_rmse_mean": 0.12330575287342072,
      "rmse_dtheta": 0.024810289964079857,
      "rmse_dx": 0.005459352396428585,
      "rmse_dy": 0.006453960668295622,
      "rmse_mean": 0.012241201475262642,
      "rotation_flip": 0.006694560870528221,
      "sparse_tokens": 32073.0,
      "step": 2009,
      "turn_loss": 0.09352532774209976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.09338412934398811,
      "grad_norm": 0.6775837540626526,
      "learning_rate": 9.389028466565904e-06,
      "loss": 0.1578,
      "mae_dtheta": 0.03954954817891121,
      "mae_dx": 0.01019804086536169,
      "mae_dy": 0.004520031623542309,
      "pose_mae_dtheta": 0.35195162892341614,
      "pose_mae_dx": 0.08297929167747498,
      "pose_mae_dy": 0.06031835451722145,
      "pose_rmse_dtheta": 0.6375454664230347,
      "pose_rmse_dx": 0.18043483793735504,
      "pose_rmse_dy": 0.15133236348628998,
      "pose_rmse_mean": 0.32310423254966736,
      "rmse_dtheta": 0.061822861433029175,
      "rmse_dx": 0.02104048617184162,
      "rmse_dy": 0.010484120808541775,
      "rmse_mean": 0.03111582249403,
      "rotation_flip": 0.008968610316514969,
      "sparse_tokens": 15902.0,
      "step": 2010,
      "turn_loss": 0.25045907497406006,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.09343058910983089,
      "grad_norm": 0.7393417954444885,
      "learning_rate": 9.388394947836278e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.018996911123394966,
      "mae_dx": 0.005951708182692528,
      "mae_dy": 0.002755834022536874,
      "pose_mae_dtheta": 0.12961579859256744,
      "pose_mae_dx": 0.05175194889307022,
      "pose_mae_dy": 0.02609974332153797,
      "pose_rmse_dtheta": 0.25557124614715576,
      "pose_rmse_dx": 0.16007277369499207,
      "pose_rmse_dy": 0.05444469675421715,
      "pose_rmse_mean": 0.15669624507427216,
      "rmse_dtheta": 0.03461337462067604,
      "rmse_dx": 0.01498813834041357,
      "rmse_dy": 0.005531094502657652,
      "rmse_mean": 0.01837753690779209,
      "rotation_flip": 0.0030120480805635452,
      "sparse_tokens": 5438.0,
      "step": 2011,
      "turn_loss": 0.1881711483001709,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.09347704887567367,
      "grad_norm": 0.5125309228897095,
      "learning_rate": 9.387761122223839e-06,
      "loss": 0.0983,
      "mae_dtheta": 0.011056877672672272,
      "mae_dx": 0.001985348993912339,
      "mae_dy": 0.002578628482297063,
      "pose_mae_dtheta": 0.07455798983573914,
      "pose_mae_dx": 0.025872183963656425,
      "pose_mae_dy": 0.03587809577584267,
      "pose_rmse_dtheta": 0.17475278675556183,
      "pose_rmse_dx": 0.06626264750957489,
      "pose_rmse_dy": 0.10127594321966171,
      "pose_rmse_mean": 0.11409713327884674,
      "rmse_dtheta": 0.022478850558400154,
      "rmse_dx": 0.006481011863797903,
      "rmse_dy": 0.005358695052564144,
      "rmse_mean": 0.011439519934356213,
      "rotation_flip": 0.005957446992397308,
      "sparse_tokens": 32057.0,
      "step": 2012,
      "turn_loss": 0.097053162753582,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.09352350864151644,
      "grad_norm": 0.4076577126979828,
      "learning_rate": 9.38712698977291e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.047037433832883835,
      "mae_dx": 0.012135651893913746,
      "mae_dy": 0.003830446396023035,
      "pose_mae_dtheta": 0.4155682325363159,
      "pose_mae_dx": 0.11325967311859131,
      "pose_mae_dy": 0.03511899337172508,
      "pose_rmse_dtheta": 0.6448614001274109,
      "pose_rmse_dx": 0.22642198204994202,
      "pose_rmse_dy": 0.08695735037326813,
      "pose_rmse_mean": 0.31941360235214233,
      "rmse_dtheta": 0.06593302637338638,
      "rmse_dx": 0.023309627547860146,
      "rmse_dy": 0.0094756456092,
      "rmse_mean": 0.032906100153923035,
      "rotation_flip": 0.012573964893817902,
      "sparse_tokens": 19637.0,
      "step": 2013,
      "turn_loss": 0.34618622064590454,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.09356996840735923,
      "grad_norm": 0.5060998201370239,
      "learning_rate": 9.386492550527836e-06,
      "loss": 0.1286,
      "mae_dtheta": 0.04002605378627777,
      "mae_dx": 0.014451099559664726,
      "mae_dy": 0.007284483872354031,
      "pose_mae_dtheta": 0.30990445613861084,
      "pose_mae_dx": 0.12140493839979172,
      "pose_mae_dy": 0.07401502877473831,
      "pose_rmse_dtheta": 0.5283077359199524,
      "pose_rmse_dx": 0.24325941503047943,
      "pose_rmse_dy": 0.16545768082141876,
      "pose_rmse_mean": 0.3123416304588318,
      "rmse_dtheta": 0.05856305733323097,
      "rmse_dx": 0.026682982221245766,
      "rmse_dy": 0.015609405934810638,
      "rmse_mean": 0.03361848369240761,
      "rotation_flip": 0.011627906933426857,
      "sparse_tokens": 17889.0,
      "step": 2014,
      "turn_loss": 0.3600514233112335,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09361642817320201,
      "grad_norm": 0.5180270671844482,
      "learning_rate": 9.385857804532983e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.011837359517812729,
      "mae_dx": 0.0016871837433427572,
      "mae_dy": 0.002632325980812311,
      "pose_mae_dtheta": 0.08224962651729584,
      "pose_mae_dx": 0.024826273322105408,
      "pose_mae_dy": 0.03338027000427246,
      "pose_rmse_dtheta": 0.20281487703323364,
      "pose_rmse_dx": 0.06349490582942963,
      "pose_rmse_dy": 0.07823464274406433,
      "pose_rmse_mean": 0.11484815180301666,
      "rmse_dtheta": 0.025380011647939682,
      "rmse_dx": 0.0050502801313996315,
      "rmse_dy": 0.005619911476969719,
      "rmse_mean": 0.01201673410832882,
      "rotation_flip": 0.0036913990043103695,
      "sparse_tokens": 32089.0,
      "step": 2015,
      "turn_loss": 0.09795214235782623,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.09366288793904479,
      "grad_norm": 0.45193350315093994,
      "learning_rate": 9.385222751832739e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.03526979312300682,
      "mae_dx": 0.009451900608837605,
      "mae_dy": 0.007620504591614008,
      "pose_mae_dtheta": 0.27913907170295715,
      "pose_mae_dx": 0.07889658957719803,
      "pose_mae_dy": 0.08372780680656433,
      "pose_rmse_dtheta": 0.5091164112091064,
      "pose_rmse_dx": 0.1910904347896576,
      "pose_rmse_dy": 0.20680584013462067,
      "pose_rmse_mean": 0.3023375868797302,
      "rmse_dtheta": 0.05488395318388939,
      "rmse_dx": 0.019807329401373863,
      "rmse_dy": 0.017763135954737663,
      "rmse_mean": 0.030818140134215355,
      "rotation_flip": 0.010224948637187481,
      "sparse_tokens": 16296.0,
      "step": 2016,
      "turn_loss": 0.33597472310066223,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.09370934770488756,
      "grad_norm": 0.7155848145484924,
      "learning_rate": 9.384587392471516e-06,
      "loss": 0.1884,
      "mae_dtheta": 0.01472986675798893,
      "mae_dx": 0.0029170657508075237,
      "mae_dy": 0.0032930695451796055,
      "pose_mae_dtheta": 0.10501093417406082,
      "pose_mae_dx": 0.031809136271476746,
      "pose_mae_dy": 0.03802214562892914,
      "pose_rmse_dtheta": 0.2472621202468872,
      "pose_rmse_dx": 0.07958468049764633,
      "pose_rmse_dy": 0.09365887194871902,
      "pose_rmse_mean": 0.14016856253147125,
      "rmse_dtheta": 0.03085951693356037,
      "rmse_dx": 0.008195598609745502,
      "rmse_dy": 0.007786033675074577,
      "rmse_mean": 0.015613717958331108,
      "rotation_flip": 0.007679465692490339,
      "sparse_tokens": 32169.0,
      "step": 2017,
      "turn_loss": 0.13495130836963654,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4240.0,
      "epoch": 0.09375580747073035,
      "grad_norm": 0.37806883454322815,
      "learning_rate": 9.383951726493741e-06,
      "loss": 0.0918,
      "mae_dtheta": 0.05306822806596756,
      "mae_dx": 0.021726667881011963,
      "mae_dy": 0.006015688180923462,
      "pose_mae_dtheta": 0.41964438557624817,
      "pose_mae_dx": 0.18712995946407318,
      "pose_mae_dy": 0.07218093425035477,
      "pose_rmse_dtheta": 0.6074605584144592,
      "pose_rmse_dx": 0.29105037450790405,
      "pose_rmse_dy": 0.13843029737472534,
      "pose_rmse_mean": 0.34564709663391113,
      "rmse_dtheta": 0.06968660652637482,
      "rmse_dx": 0.03357075899839401,
      "rmse_dy": 0.010480665601789951,
      "rmse_mean": 0.037912677973508835,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 3526.0,
      "step": 2018,
      "turn_loss": 0.3723721206188202,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.09380226723657313,
      "grad_norm": 0.5089123249053955,
      "learning_rate": 9.383315753943872e-06,
      "loss": 0.1112,
      "mae_dtheta": 0.02698516845703125,
      "mae_dx": 0.01804053597152233,
      "mae_dy": 0.008172653615474701,
      "pose_mae_dtheta": 0.20573480427265167,
      "pose_mae_dx": 0.13863730430603027,
      "pose_mae_dy": 0.09740834683179855,
      "pose_rmse_dtheta": 0.3284604549407959,
      "pose_rmse_dx": 0.2658235430717468,
      "pose_rmse_dy": 0.2193240374326706,
      "pose_rmse_mean": 0.2712026834487915,
      "rmse_dtheta": 0.038482774049043655,
      "rmse_dx": 0.03155473247170448,
      "rmse_dy": 0.014281128533184528,
      "rmse_mean": 0.028106212615966797,
      "rotation_flip": 0.0060240961611270905,
      "sparse_tokens": 5385.0,
      "step": 2019,
      "turn_loss": 0.29916882514953613,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09384872700241591,
      "grad_norm": 0.6770926117897034,
      "learning_rate": 9.382679474866376e-06,
      "loss": 0.1087,
      "mae_dtheta": 0.010405659675598145,
      "mae_dx": 0.0026903576217591763,
      "mae_dy": 0.002081902464851737,
      "pose_mae_dtheta": 0.07351759076118469,
      "pose_mae_dx": 0.03135168179869652,
      "pose_mae_dy": 0.029435060918331146,
      "pose_rmse_dtheta": 0.15349599719047546,
      "pose_rmse_dx": 0.09048474580049515,
      "pose_rmse_dy": 0.061279721558094025,
      "pose_rmse_mean": 0.10175348818302155,
      "rmse_dtheta": 0.020860688760876656,
      "rmse_dx": 0.008273974061012268,
      "rmse_dy": 0.0048060170374810696,
      "rmse_mean": 0.011313560418784618,
      "rotation_flip": 0.007878151722252369,
      "sparse_tokens": 32089.0,
      "step": 2020,
      "turn_loss": 0.09479257464408875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.09389518676825868,
      "grad_norm": 0.560344398021698,
      "learning_rate": 9.382042889305754e-06,
      "loss": 0.1571,
      "mae_dtheta": 0.013772801496088505,
      "mae_dx": 0.002459288574755192,
      "mae_dy": 0.003762306645512581,
      "pose_mae_dtheta": 0.08774840831756592,
      "pose_mae_dx": 0.03369845077395439,
      "pose_mae_dy": 0.038773100823163986,
      "pose_rmse_dtheta": 0.18487413227558136,
      "pose_rmse_dx": 0.08366914838552475,
      "pose_rmse_dy": 0.0740734413266182,
      "pose_rmse_mean": 0.11420556902885437,
      "rmse_dtheta": 0.02702469564974308,
      "rmse_dx": 0.0072979675605893135,
      "rmse_dy": 0.007942814379930496,
      "rmse_mean": 0.014088492840528488,
      "rotation_flip": 0.007077140733599663,
      "sparse_tokens": 32057.0,
      "step": 2021,
      "turn_loss": 0.12225382030010223,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.09394164653410148,
      "grad_norm": 0.48875558376312256,
      "learning_rate": 9.381405997306521e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.04241245612502098,
      "mae_dx": 0.013162239454686642,
      "mae_dy": 0.0072619132697582245,
      "pose_mae_dtheta": 0.3329676687717438,
      "pose_mae_dx": 0.12360965460538864,
      "pose_mae_dy": 0.09772015362977982,
      "pose_rmse_dtheta": 0.5241742730140686,
      "pose_rmse_dx": 0.24949078261852264,
      "pose_rmse_dy": 0.1919337660074234,
      "pose_rmse_mean": 0.3218662738800049,
      "rmse_dtheta": 0.05737676844000816,
      "rmse_dx": 0.02609611116349697,
      "rmse_dy": 0.01242207270115614,
      "rmse_mean": 0.0319649837911129,
      "rotation_flip": 0.0191431175917387,
      "sparse_tokens": 18564.0,
      "step": 2022,
      "turn_loss": 0.2933187186717987,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.09398810629994425,
      "grad_norm": 0.4181556701660156,
      "learning_rate": 9.380768798913213e-06,
      "loss": 0.0898,
      "mae_dtheta": 0.007893684320151806,
      "mae_dx": 0.002702317200601101,
      "mae_dy": 0.0005920331459492445,
      "pose_mae_dtheta": 0.057462628930807114,
      "pose_mae_dx": 0.023020412772893906,
      "pose_mae_dy": 0.006233359687030315,
      "pose_rmse_dtheta": 0.20304609835147858,
      "pose_rmse_dx": 0.06200220808386803,
      "pose_rmse_dy": 0.01377165224403143,
      "pose_rmse_mean": 0.09293998777866364,
      "rmse_dtheta": 0.02597450278699398,
      "rmse_dx": 0.007481333799660206,
      "rmse_dy": 0.0016011518891900778,
      "rmse_mean": 0.01168566383421421,
      "rotation_flip": 0.0037902717012912035,
      "sparse_tokens": 32201.0,
      "step": 2023,
      "turn_loss": 0.07477349787950516,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.09403456606578703,
      "grad_norm": 0.452755868434906,
      "learning_rate": 9.380131294170394e-06,
      "loss": 0.1366,
      "mae_dtheta": 0.01125924102962017,
      "mae_dx": 0.0020977456588298082,
      "mae_dy": 0.003269527107477188,
      "pose_mae_dtheta": 0.07932880520820618,
      "pose_mae_dx": 0.03331969305872917,
      "pose_mae_dy": 0.03831750527024269,
      "pose_rmse_dtheta": 0.18284760415554047,
      "pose_rmse_dx": 0.09540390223264694,
      "pose_rmse_dy": 0.09215782582759857,
      "pose_rmse_mean": 0.1234697699546814,
      "rmse_dtheta": 0.023549549281597137,
      "rmse_dx": 0.0063130795024335384,
      "rmse_dy": 0.007808735594153404,
      "rmse_mean": 0.01255712192505598,
      "rotation_flip": 0.0035445280373096466,
      "sparse_tokens": 32041.0,
      "step": 2024,
      "turn_loss": 0.09709173440933228,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34714.0,
      "epoch": 0.0940810258316298,
      "grad_norm": 0.3500058054924011,
      "learning_rate": 9.379493483122641e-06,
      "loss": 0.1237,
      "mae_dtheta": 0.029724204912781715,
      "mae_dx": 0.01012713648378849,
      "mae_dy": 0.005123519338667393,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.35000571608543396,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 143.87205505371094,
      "model/head/act_norm_mean": 106.5787273656542,
      "model/head/act_norm_min": 69.49452209472656,
      "model/head/act_over_embed": 73.24189925144385,
      "model/head/grad_frac": 0.11487249284982681,
      "model/head/grad_norm": 0.04020603001117706,
      "model/head/grad_zero_frac": 0.00019385304767638445,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6767760660046729,
      "model/head/update_ratio": 0.0006972869741730392,
      "model/head/weight_delta": 5.1452813148498535,
      "model/head/weight_delta_rel": 0.0902634710073471,
      "model/head/weight_norm": 57.66066360473633,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4142796993255615,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4142200681898329,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4141528606414795,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2846559088494303,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09394507110118866,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03288131207227707,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5023509837962963,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010690168710425496,
      "model/modality_embedder.encoders.pose/weight_delta": 1.67484712600708,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05472247675061226,
      "model/modality_embedder.encoders.pose/weight_norm": 30.758460998535156,
      "model/modality_embedder/grad_frac": 0.09394507110118866,
      "model/modality_embedder/grad_norm": 0.03288131207227707,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5023509837962963,
      "model/modality_embedder/update_ratio": 0.0010690168710425496,
      "model/modality_embedder/weight_delta": 1.67484712600708,
      "model/modality_embedder/weight_delta_rel": 0.05472247675061226,
      "model/modality_embedder/weight_norm": 30.758460998535156,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.9486312866211,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.100722259308707,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.196588516235352,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.875032608966162,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11089533567428589,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0388140007853508,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014061343390494585,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.016271710395813,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.037033554166555405,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.60333824157715,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.43672180175781,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.99658572541166,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.30210018157959,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.490678370078022,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09910866618156433,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03468859940767288,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001189419417642057,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.2654104232788086,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.043834805488586426,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.1643123626709,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 82.90547943115234,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.679262164367305,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.620833396911621,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.647029372393366,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09655697643756866,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.033795494586229324,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011228189105167985,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.3465163707733154,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.045213498175144196,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.098793029785156,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.26656341552734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.65016781634772,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.094839096069336,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.001454188343736,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09902913868427277,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.034660764038562775,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011753091821447015,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.151749849319458,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.039361342787742615,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.49076271057129,
      "model/normalizer/grad_frac": 0.39923030138015747,
      "model/normalizer/grad_norm": 0.13973288238048553,
      "model/normalizer/grad_zero_frac": 0.0001772607647581026,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017919960664585233,
      "model/normalizer/weight_delta": 2.460953950881958,
      "model/normalizer/weight_delta_rel": 0.0316956602036953,
      "model/normalizer/weight_norm": 77.97611236572266,
      "pose_mae_dtheta": 0.21863599121570587,
      "pose_mae_dx": 0.08164267241954803,
      "pose_mae_dy": 0.06460817158222198,
      "pose_rmse_dtheta": 0.38165992498397827,
      "pose_rmse_dx": 0.1991019994020462,
      "pose_rmse_dy": 0.14520812034606934,
      "pose_rmse_mean": 0.24199001491069794,
      "rmse_dtheta": 0.045908182859420776,
      "rmse_dx": 0.02230747789144516,
      "rmse_dy": 0.009202243760228157,
      "rmse_mean": 0.025805968791246414,
      "rotation_flip": 0.017575757578015327,
      "sparse_tokens": 28040.0,
      "step": 2025,
      "turn_loss": 0.26857587695121765,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.09412748559747258,
      "grad_norm": 0.5197067856788635,
      "learning_rate": 9.37885536581456e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.014356978237628937,
      "mae_dx": 0.00222574220970273,
      "mae_dy": 0.004089918918907642,
      "pose_mae_dtheta": 0.09292493760585785,
      "pose_mae_dx": 0.035659290850162506,
      "pose_mae_dy": 0.04599311202764511,
      "pose_rmse_dtheta": 0.19912409782409668,
      "pose_rmse_dx": 0.07641668617725372,
      "pose_rmse_dy": 0.09163758903741837,
      "pose_rmse_mean": 0.12239278852939606,
      "rmse_dtheta": 0.02618296630680561,
      "rmse_dx": 0.005503648892045021,
      "rmse_dy": 0.007605426944792271,
      "rmse_mean": 0.013097347691655159,
      "rotation_flip": 0.006197706796228886,
      "sparse_tokens": 32121.0,
      "step": 2026,
      "turn_loss": 0.11841261386871338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.09417394536331537,
      "grad_norm": 0.5689525604248047,
      "learning_rate": 9.37821694229077e-06,
      "loss": 0.1654,
      "mae_dtheta": 0.03398670256137848,
      "mae_dx": 0.013552679680287838,
      "mae_dy": 0.008455568924546242,
      "pose_mae_dtheta": 0.25845974683761597,
      "pose_mae_dx": 0.10023051500320435,
      "pose_mae_dy": 0.09301883727312088,
      "pose_rmse_dtheta": 0.4434790015220642,
      "pose_rmse_dx": 0.23526868224143982,
      "pose_rmse_dy": 0.18048866093158722,
      "pose_rmse_mean": 0.2864121198654175,
      "rmse_dtheta": 0.048441383987665176,
      "rmse_dx": 0.027499772608280182,
      "rmse_dy": 0.015089602209627628,
      "rmse_mean": 0.030343588441610336,
      "rotation_flip": 0.01797385700047016,
      "sparse_tokens": 11548.0,
      "step": 2027,
      "turn_loss": 0.34822511672973633,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.09422040512915815,
      "grad_norm": 0.41499781608581543,
      "learning_rate": 9.377578212595922e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.008773768320679665,
      "mae_dx": 0.0018452918156981468,
      "mae_dy": 0.0015618804609403014,
      "pose_mae_dtheta": 0.06037598475813866,
      "pose_mae_dx": 0.01901261694729328,
      "pose_mae_dy": 0.018367333337664604,
      "pose_rmse_dtheta": 0.177994042634964,
      "pose_rmse_dx": 0.05260224640369415,
      "pose_rmse_dy": 0.05139440298080444,
      "pose_rmse_mean": 0.09399690479040146,
      "rmse_dtheta": 0.024124763906002045,
      "rmse_dx": 0.005523946601897478,
      "rmse_dy": 0.004738234914839268,
      "rmse_mean": 0.011462314985692501,
      "rotation_flip": 0.0019685039296746254,
      "sparse_tokens": 32153.0,
      "step": 2028,
      "turn_loss": 0.0605887733399868,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.09426686489500093,
      "grad_norm": 0.47535470128059387,
      "learning_rate": 9.376939176774678e-06,
      "loss": 0.1691,
      "mae_dtheta": 0.007421022281050682,
      "mae_dx": 0.0021331761963665485,
      "mae_dy": 0.0007714772364124656,
      "pose_mae_dtheta": 0.04896223545074463,
      "pose_mae_dx": 0.01840616576373577,
      "pose_mae_dy": 0.01089770719408989,
      "pose_rmse_dtheta": 0.16297492384910583,
      "pose_rmse_dx": 0.04670665040612221,
      "pose_rmse_dy": 0.03658367320895195,
      "pose_rmse_mean": 0.0820884183049202,
      "rmse_dtheta": 0.022720666602253914,
      "rmse_dx": 0.006116002332419157,
      "rmse_dy": 0.0020587400067597628,
      "rmse_mean": 0.01029847003519535,
      "rotation_flip": 0.0029865605756640434,
      "sparse_tokens": 32217.0,
      "step": 2029,
      "turn_loss": 0.06145092099905014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.0943133246608437,
      "grad_norm": 0.7709333300590515,
      "learning_rate": 9.37629983487173e-06,
      "loss": 0.2815,
      "mae_dtheta": 0.031849559396505356,
      "mae_dx": 0.013936824165284634,
      "mae_dy": 0.0052733090706169605,
      "pose_mae_dtheta": 0.27566099166870117,
      "pose_mae_dx": 0.12559634447097778,
      "pose_mae_dy": 0.06294280290603638,
      "pose_rmse_dtheta": 0.4151310324668884,
      "pose_rmse_dx": 0.2548849582672119,
      "pose_rmse_dy": 0.1347898542881012,
      "pose_rmse_mean": 0.2682686448097229,
      "rmse_dtheta": 0.04656926169991493,
      "rmse_dx": 0.026208922266960144,
      "rmse_dy": 0.009348531253635883,
      "rmse_mean": 0.02737557142972946,
      "rotation_flip": 0.007029877044260502,
      "sparse_tokens": 8240.0,
      "step": 2030,
      "turn_loss": 0.3050200641155243,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.0943597844266865,
      "grad_norm": 0.44118377566337585,
      "learning_rate": 9.375660186931785e-06,
      "loss": 0.0971,
      "mae_dtheta": 0.03290577605366707,
      "mae_dx": 0.013857035897672176,
      "mae_dy": 0.004025565460324287,
      "pose_mae_dtheta": 0.2717796564102173,
      "pose_mae_dx": 0.11727958172559738,
      "pose_mae_dy": 0.05430497229099274,
      "pose_rmse_dtheta": 0.44303345680236816,
      "pose_rmse_dx": 0.23483845591545105,
      "pose_rmse_dy": 0.14518241584300995,
      "pose_rmse_mean": 0.27435147762298584,
      "rmse_dtheta": 0.04778455197811127,
      "rmse_dx": 0.02638082392513752,
      "rmse_dy": 0.007790750823915005,
      "rmse_mean": 0.02731870859861374,
      "rotation_flip": 0.007949125953018665,
      "sparse_tokens": 10062.0,
      "step": 2031,
      "turn_loss": 0.25668567419052124,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09440624419252927,
      "grad_norm": 0.6535640954971313,
      "learning_rate": 9.375020232999574e-06,
      "loss": 0.1363,
      "mae_dtheta": 0.01181703619658947,
      "mae_dx": 0.002086958149448037,
      "mae_dy": 0.001971903257071972,
      "pose_mae_dtheta": 0.09210193902254105,
      "pose_mae_dx": 0.025253282859921455,
      "pose_mae_dy": 0.028841959312558174,
      "pose_rmse_dtheta": 0.2502574920654297,
      "pose_rmse_dx": 0.07420868426561356,
      "pose_rmse_dy": 0.08106387406587601,
      "pose_rmse_mean": 0.13517668843269348,
      "rmse_dtheta": 0.028545228764414787,
      "rmse_dx": 0.007040895987302065,
      "rmse_dy": 0.005089746788144112,
      "rmse_mean": 0.013558624312281609,
      "rotation_flip": 0.0016384489135816693,
      "sparse_tokens": 32073.0,
      "step": 2032,
      "turn_loss": 0.08243716508150101,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.09445270395837205,
      "grad_norm": 0.6432223916053772,
      "learning_rate": 9.37437997311985e-06,
      "loss": 0.1688,
      "mae_dtheta": 0.02402208000421524,
      "mae_dx": 0.011190264485776424,
      "mae_dy": 0.005122576840221882,
      "pose_mae_dtheta": 0.18084630370140076,
      "pose_mae_dx": 0.09184805303812027,
      "pose_mae_dy": 0.06342016160488129,
      "pose_rmse_dtheta": 0.33685237169265747,
      "pose_rmse_dx": 0.2195846140384674,
      "pose_rmse_dy": 0.18660713732242584,
      "pose_rmse_mean": 0.2476813793182373,
      "rmse_dtheta": 0.04015915468335152,
      "rmse_dx": 0.023646129295229912,
      "rmse_dy": 0.012229099869728088,
      "rmse_mean": 0.025344794616103172,
      "rotation_flip": 0.013274336233735085,
      "sparse_tokens": 15176.0,
      "step": 2033,
      "turn_loss": 0.23248693346977234,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09449916372421482,
      "grad_norm": 0.5772405862808228,
      "learning_rate": 9.373739407337389e-06,
      "loss": 0.0885,
      "mae_dtheta": 0.01442062109708786,
      "mae_dx": 0.001940121059305966,
      "mae_dy": 0.003619113238528371,
      "pose_mae_dtheta": 0.09006231278181076,
      "pose_mae_dx": 0.03203459456562996,
      "pose_mae_dy": 0.043912384659051895,
      "pose_rmse_dtheta": 0.16980737447738647,
      "pose_rmse_dx": 0.076264888048172,
      "pose_rmse_dy": 0.09296677261590958,
      "pose_rmse_mean": 0.11301301419734955,
      "rmse_dtheta": 0.02451271191239357,
      "rmse_dx": 0.004819206893444061,
      "rmse_dy": 0.006786797195672989,
      "rmse_mean": 0.01203957200050354,
      "rotation_flip": 0.004744154401123524,
      "sparse_tokens": 32073.0,
      "step": 2034,
      "turn_loss": 0.12239199876785278,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.09454562349005761,
      "grad_norm": 0.7263113260269165,
      "learning_rate": 9.37309853569698e-06,
      "loss": 0.2385,
      "mae_dtheta": 0.02989358827471733,
      "mae_dx": 0.004210683051496744,
      "mae_dy": 0.0033994601108133793,
      "pose_mae_dtheta": 0.2534804344177246,
      "pose_mae_dx": 0.03246273100376129,
      "pose_mae_dy": 0.03765067458152771,
      "pose_rmse_dtheta": 0.4878680408000946,
      "pose_rmse_dx": 0.08054286241531372,
      "pose_rmse_dy": 0.08747197687625885,
      "pose_rmse_mean": 0.21862761676311493,
      "rmse_dtheta": 0.0499984547495842,
      "rmse_dx": 0.011482841335237026,
      "rmse_dy": 0.007490258663892746,
      "rmse_mean": 0.022990521043539047,
      "rotation_flip": 0.003937007859349251,
      "sparse_tokens": 4147.0,
      "step": 2035,
      "turn_loss": 0.15630100667476654,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.09459208325590039,
      "grad_norm": 0.4722112715244293,
      "learning_rate": 9.372457358243445e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.028944235295057297,
      "mae_dx": 0.010697991587221622,
      "mae_dy": 0.006473182234913111,
      "pose_mae_dtheta": 0.1958436220884323,
      "pose_mae_dx": 0.09108689427375793,
      "pose_mae_dy": 0.06969436258077621,
      "pose_rmse_dtheta": 0.36414191126823425,
      "pose_rmse_dx": 0.2141345590353012,
      "pose_rmse_dy": 0.1373245120048523,
      "pose_rmse_mean": 0.23853366076946259,
      "rmse_dtheta": 0.04721936583518982,
      "rmse_dx": 0.022130288183689117,
      "rmse_dy": 0.013483776710927486,
      "rmse_mean": 0.027611143887043,
      "rotation_flip": 0.006403414998203516,
      "sparse_tokens": 16532.0,
      "step": 2036,
      "turn_loss": 0.2509923279285431,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.09463854302174317,
      "grad_norm": 0.46778935194015503,
      "learning_rate": 9.37181587502162e-06,
      "loss": 0.0953,
      "mae_dtheta": 0.02884489670395851,
      "mae_dx": 0.012790899723768234,
      "mae_dy": 0.004226071760058403,
      "pose_mae_dtheta": 0.2610051929950714,
      "pose_mae_dx": 0.10379808396100998,
      "pose_mae_dy": 0.05468498542904854,
      "pose_rmse_dtheta": 0.43227437138557434,
      "pose_rmse_dx": 0.2132735699415207,
      "pose_rmse_dy": 0.11943910270929337,
      "pose_rmse_mean": 0.2549957036972046,
      "rmse_dtheta": 0.044944990426301956,
      "rmse_dx": 0.02462601847946644,
      "rmse_dy": 0.007308297324925661,
      "rmse_mean": 0.02562643587589264,
      "rotation_flip": 0.010452961549162865,
      "sparse_tokens": 15345.0,
      "step": 2037,
      "turn_loss": 0.2534746527671814,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.09468500278758595,
      "grad_norm": 0.45057037472724915,
      "learning_rate": 9.371174086076364e-06,
      "loss": 0.0966,
      "mae_dtheta": 0.012314082123339176,
      "mae_dx": 0.002420862438157201,
      "mae_dy": 0.0022493519354611635,
      "pose_mae_dtheta": 0.08352351933717728,
      "pose_mae_dx": 0.026330552995204926,
      "pose_mae_dy": 0.02594541385769844,
      "pose_rmse_dtheta": 0.20461168885231018,
      "pose_rmse_dx": 0.06269997358322144,
      "pose_rmse_dy": 0.0664551630616188,
      "pose_rmse_mean": 0.11125560849905014,
      "rmse_dtheta": 0.026136377826333046,
      "rmse_dx": 0.006781053263694048,
      "rmse_dy": 0.005687141325324774,
      "rmse_mean": 0.012868191115558147,
      "rotation_flip": 0.00506033468991518,
      "sparse_tokens": 32153.0,
      "step": 2038,
      "turn_loss": 0.09480930864810944,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.09473146255342874,
      "grad_norm": 0.5334362387657166,
      "learning_rate": 9.370531991452559e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.012038837186992168,
      "mae_dx": 0.0024402951821684837,
      "mae_dy": 0.0034053681883960962,
      "pose_mae_dtheta": 0.08971982449293137,
      "pose_mae_dx": 0.036235660314559937,
      "pose_mae_dy": 0.038929689675569534,
      "pose_rmse_dtheta": 0.1846221536397934,
      "pose_rmse_dx": 0.07972528785467148,
      "pose_rmse_dy": 0.10155397653579712,
      "pose_rmse_mean": 0.1219671368598938,
      "rmse_dtheta": 0.024101516231894493,
      "rmse_dx": 0.006236358545720577,
      "rmse_dy": 0.007615331094712019,
      "rmse_mean": 0.012651069089770317,
      "rotation_flip": 0.0060606058686971664,
      "sparse_tokens": 32153.0,
      "step": 2039,
      "turn_loss": 0.10806023329496384,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36338.0,
      "epoch": 0.09477792231927151,
      "grad_norm": 0.6189917922019958,
      "learning_rate": 9.369889591195105e-06,
      "loss": 0.2302,
      "mae_dtheta": 0.02852654829621315,
      "mae_dx": 0.013342625461518764,
      "mae_dy": 0.006321277469396591,
      "pose_mae_dtheta": 0.22283276915550232,
      "pose_mae_dx": 0.10137668251991272,
      "pose_mae_dy": 0.06479085236787796,
      "pose_rmse_dtheta": 0.3795180916786194,
      "pose_rmse_dx": 0.21052613854408264,
      "pose_rmse_dy": 0.15705260634422302,
      "pose_rmse_mean": 0.24903230369091034,
      "rmse_dtheta": 0.043246809393167496,
      "rmse_dx": 0.026407860219478607,
      "rmse_dy": 0.013514775782823563,
      "rmse_mean": 0.027723148465156555,
      "rotation_flip": 0.009999999776482582,
      "sparse_tokens": 29738.0,
      "step": 2040,
      "turn_loss": 0.2809617817401886,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.09482438208511429,
      "grad_norm": 0.6196252107620239,
      "learning_rate": 9.369246885348926e-06,
      "loss": 0.1576,
      "mae_dtheta": 0.03056136518716812,
      "mae_dx": 0.009061849676072598,
      "mae_dy": 0.004494624678045511,
      "pose_mae_dtheta": 0.2279779016971588,
      "pose_mae_dx": 0.07883913815021515,
      "pose_mae_dy": 0.05099041014909744,
      "pose_rmse_dtheta": 0.45584240555763245,
      "pose_rmse_dx": 0.1834804266691208,
      "pose_rmse_dy": 0.1417236328125,
      "pose_rmse_mean": 0.2603488266468048,
      "rmse_dtheta": 0.05160106346011162,
      "rmse_dx": 0.01926194503903389,
      "rmse_dy": 0.01214341726154089,
      "rmse_mean": 0.02766880951821804,
      "rotation_flip": 0.007987220771610737,
      "sparse_tokens": 25041.0,
      "step": 2041,
      "turn_loss": 0.23951303958892822,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.09487084185095707,
      "grad_norm": 0.5195263028144836,
      "learning_rate": 9.368603873958968e-06,
      "loss": 0.1314,
      "mae_dtheta": 0.010491101071238518,
      "mae_dx": 0.0025980600621551275,
      "mae_dy": 0.0028819998260587454,
      "pose_mae_dtheta": 0.07616056501865387,
      "pose_mae_dx": 0.027397211641073227,
      "pose_mae_dy": 0.02967371605336666,
      "pose_rmse_dtheta": 0.16611197590827942,
      "pose_rmse_dx": 0.07362816482782364,
      "pose_rmse_dy": 0.06744056940078735,
      "pose_rmse_mean": 0.10239356756210327,
      "rmse_dtheta": 0.02310233749449253,
      "rmse_dx": 0.007412551902234554,
      "rmse_dy": 0.007114747539162636,
      "rmse_mean": 0.012543211691081524,
      "rotation_flip": 0.00466562993824482,
      "sparse_tokens": 32121.0,
      "step": 2042,
      "turn_loss": 0.1020267978310585,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09491730161679986,
      "grad_norm": 0.5882494449615479,
      "learning_rate": 9.367960557070194e-06,
      "loss": 0.1764,
      "mae_dtheta": 0.012831310741603374,
      "mae_dx": 0.0024562529288232327,
      "mae_dy": 0.003095164429396391,
      "pose_mae_dtheta": 0.09280253201723099,
      "pose_mae_dx": 0.03237975016236305,
      "pose_mae_dy": 0.03473181277513504,
      "pose_rmse_dtheta": 0.23629413545131683,
      "pose_rmse_dx": 0.0875934287905693,
      "pose_rmse_dy": 0.0844871997833252,
      "pose_rmse_mean": 0.13612492382526398,
      "rmse_dtheta": 0.02657829225063324,
      "rmse_dx": 0.0068718446418643,
      "rmse_dy": 0.006749657914042473,
      "rmse_mean": 0.013399931602180004,
      "rotation_flip": 0.006264682859182358,
      "sparse_tokens": 32073.0,
      "step": 2043,
      "turn_loss": 0.10226848721504211,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31790.0,
      "epoch": 0.09496376138264263,
      "grad_norm": 0.5342822074890137,
      "learning_rate": 9.367316934727598e-06,
      "loss": 0.1602,
      "mae_dtheta": 0.03137873485684395,
      "mae_dx": 0.01415878627449274,
      "mae_dy": 0.005639073438942432,
      "pose_mae_dtheta": 0.242033451795578,
      "pose_mae_dx": 0.10626178234815598,
      "pose_mae_dy": 0.062406912446022034,
      "pose_rmse_dtheta": 0.40998196601867676,
      "pose_rmse_dx": 0.2479379028081894,
      "pose_rmse_dy": 0.14559364318847656,
      "pose_rmse_mean": 0.26783785223960876,
      "rmse_dtheta": 0.04880552738904953,
      "rmse_dx": 0.027431469410657883,
      "rmse_dy": 0.012110128067433834,
      "rmse_mean": 0.029449041932821274,
      "rotation_flip": 0.015200000256299973,
      "sparse_tokens": 23298.0,
      "step": 2044,
      "turn_loss": 0.3628576695919037,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.09501022114848541,
      "grad_norm": 0.595032811164856,
      "learning_rate": 9.366673006976181e-06,
      "loss": 0.1606,
      "mae_dtheta": 0.033589914441108704,
      "mae_dx": 0.0014483071863651276,
      "mae_dy": 0.004808421712368727,
      "pose_mae_dtheta": 0.29881998896598816,
      "pose_mae_dx": 0.033780939877033234,
      "pose_mae_dy": 0.05927747115492821,
      "pose_rmse_dtheta": 0.5915058851242065,
      "pose_rmse_dx": 0.0763140469789505,
      "pose_rmse_dy": 0.12914791703224182,
      "pose_rmse_mean": 0.2656559646129608,
      "rmse_dtheta": 0.057161446660757065,
      "rmse_dx": 0.002852469449862838,
      "rmse_dy": 0.008647634647786617,
      "rmse_mean": 0.022887183353304863,
      "rotation_flip": 0.013333333656191826,
      "sparse_tokens": 3598.0,
      "step": 2045,
      "turn_loss": 0.17893677949905396,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.09505668091432819,
      "grad_norm": 0.6643252372741699,
      "learning_rate": 9.366028773860981e-06,
      "loss": 0.1768,
      "mae_dtheta": 0.038170576095581055,
      "mae_dx": 0.008776804432272911,
      "mae_dy": 0.005003634840250015,
      "pose_mae_dtheta": 0.29407820105552673,
      "pose_mae_dx": 0.06560547649860382,
      "pose_mae_dy": 0.04668379947543144,
      "pose_rmse_dtheta": 0.5795875191688538,
      "pose_rmse_dx": 0.13903118669986725,
      "pose_rmse_dy": 0.13562177121639252,
      "pose_rmse_mean": 0.28474682569503784,
      "rmse_dtheta": 0.06104574352502823,
      "rmse_dx": 0.01794241927564144,
      "rmse_dy": 0.012175902724266052,
      "rmse_mean": 0.03038802370429039,
      "rotation_flip": 0.012578615918755531,
      "sparse_tokens": 14836.0,
      "step": 2046,
      "turn_loss": 0.21904712915420532,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.09510314068017098,
      "grad_norm": 0.46308982372283936,
      "learning_rate": 9.365384235427042e-06,
      "loss": 0.1143,
      "mae_dtheta": 0.013467811979353428,
      "mae_dx": 0.0021629314869642258,
      "mae_dy": 0.0034822230227291584,
      "pose_mae_dtheta": 0.09051787853240967,
      "pose_mae_dx": 0.027097484096884727,
      "pose_mae_dy": 0.03961559757590294,
      "pose_rmse_dtheta": 0.23922118544578552,
      "pose_rmse_dx": 0.057994548231363297,
      "pose_rmse_dy": 0.1073877289891243,
      "pose_rmse_mean": 0.1348678171634674,
      "rmse_dtheta": 0.029410595074295998,
      "rmse_dx": 0.005396005231887102,
      "rmse_dy": 0.007685066666454077,
      "rmse_mean": 0.014163888990879059,
      "rotation_flip": 0.006988120265305042,
      "sparse_tokens": 32153.0,
      "step": 2047,
      "turn_loss": 0.12778285145759583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09514960044601375,
      "grad_norm": 0.6524670124053955,
      "learning_rate": 9.36473939171944e-06,
      "loss": 0.1447,
      "mae_dtheta": 0.011750059202313423,
      "mae_dx": 0.0030481477733701468,
      "mae_dy": 0.003433004952967167,
      "pose_mae_dtheta": 0.08454187959432602,
      "pose_mae_dx": 0.03056492656469345,
      "pose_mae_dy": 0.03352254256606102,
      "pose_rmse_dtheta": 0.23515306413173676,
      "pose_rmse_dx": 0.1015959084033966,
      "pose_rmse_dy": 0.10024143755435944,
      "pose_rmse_mean": 0.14566347002983093,
      "rmse_dtheta": 0.02720130793750286,
      "rmse_dx": 0.010084501467645168,
      "rmse_dy": 0.010272758081555367,
      "rmse_mean": 0.015852857381105423,
      "rotation_flip": 0.006986492779105902,
      "sparse_tokens": 32073.0,
      "step": 2048,
      "turn_loss": 0.11921472102403641,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.09519606021185653,
      "grad_norm": 0.5744276642799377,
      "learning_rate": 9.364094242783272e-06,
      "loss": 0.1515,
      "mae_dtheta": 0.037418775260448456,
      "mae_dx": 0.013068675063550472,
      "mae_dy": 0.00596895394846797,
      "pose_mae_dtheta": 0.27564579248428345,
      "pose_mae_dx": 0.11424035578966141,
      "pose_mae_dy": 0.05891229957342148,
      "pose_rmse_dtheta": 0.44755613803863525,
      "pose_rmse_dx": 0.2344716191291809,
      "pose_rmse_dy": 0.13076700270175934,
      "pose_rmse_mean": 0.270931601524353,
      "rmse_dtheta": 0.05451535806059837,
      "rmse_dx": 0.024710243567824364,
      "rmse_dy": 0.012766269966959953,
      "rmse_mean": 0.030663957819342613,
      "rotation_flip": 0.02097902074456215,
      "sparse_tokens": 20623.0,
      "step": 2049,
      "turn_loss": 0.2723003625869751,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 14253.0,
      "epoch": 0.09524251997769931,
      "grad_norm": 0.5474071502685547,
      "learning_rate": 9.36344878866365e-06,
      "loss": 0.1459,
      "mae_dtheta": 0.038207996636629105,
      "mae_dx": 0.011985167860984802,
      "mae_dy": 0.006608538329601288,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5474071502685547,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 125.68244934082031,
      "model/head/act_norm_mean": 99.40753728693181,
      "model/head/act_norm_min": 74.34358215332031,
      "model/head/act_over_embed": 68.31379029160654,
      "model/head/grad_frac": 0.08481036126613617,
      "model/head/grad_norm": 0.046425797045230865,
      "model/head/grad_zero_frac": 0.0001856039889389649,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6862127130681818,
      "model/head/update_ratio": 0.0008050568285398185,
      "model/head/weight_delta": 5.174294471740723,
      "model/head/weight_delta_rel": 0.09077244997024536,
      "model/head/weight_norm": 57.667728424072266,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.414213091135025,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.414213091135025,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.414213091135025,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2846511141520461,
      "model/modality_embedder.encoders.pose/grad_frac": 0.049692269414663315,
      "model/modality_embedder.encoders.pose/grad_norm": 0.027201903983950615,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0008843329269438982,
      "model/modality_embedder.encoders.pose/weight_delta": 1.6823197603225708,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.054966628551483154,
      "model/modality_embedder.encoders.pose/weight_norm": 30.75979995727539,
      "model/modality_embedder/grad_frac": 0.049692269414663315,
      "model/modality_embedder/grad_norm": 0.027201903983950615,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0008843329269438982,
      "model/modality_embedder/weight_delta": 1.6823197603225708,
      "model/modality_embedder/weight_delta_rel": 0.054966628551483154,
      "model/modality_embedder/weight_norm": 30.75979995727539,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 70.14715576171875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.412630772005773,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.222596168518066,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.402169696877586,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06657444685697556,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.036443326622247696,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013201039982959628,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.0266523361206055,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03741183131933212,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.60640525817871,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 71.59478759765625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.26316738816739,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.625516891479492,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.986666422353105,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06537177413702011,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03578497841954231,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012268164427950978,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.2792601585388184,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04431457072496414,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.168973922729492,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 73.24151611328125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.90832713293651,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.230488777160645,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.117235601186643,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07037361711263657,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03852302208542824,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012797010131180286,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.3618683815002441,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04572898894548416,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.10314178466797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 73.82554626464844,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.92331518308081,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.131019592285156,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.501954253861147,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09302407503128052,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05092204362154007,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017264875350520015,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.1633586883544922,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.03975807875394821,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.494590759277344,
      "model/normalizer/grad_frac": 0.32798242568969727,
      "model/normalizer/grad_norm": 0.17953991889953613,
      "model/normalizer/grad_zero_frac": 0.00020325901277828962,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002302344888448715,
      "model/normalizer/weight_delta": 2.487403392791748,
      "model/normalizer/weight_delta_rel": 0.03203631564974785,
      "model/normalizer/weight_norm": 77.98133087158203,
      "pose_mae_dtheta": 0.3055492639541626,
      "pose_mae_dx": 0.09611242264509201,
      "pose_mae_dy": 0.07185117155313492,
      "pose_rmse_dtheta": 0.5417238473892212,
      "pose_rmse_dx": 0.20286425948143005,
      "pose_rmse_dy": 0.16425998508930206,
      "pose_rmse_mean": 0.30294936895370483,
      "rmse_dtheta": 0.0556856133043766,
      "rmse_dx": 0.023777084425091743,
      "rmse_dy": 0.01368519477546215,
      "rmse_mean": 0.031049299985170364,
      "rotation_flip": 0.014399999752640724,
      "sparse_tokens": 12287.0,
      "step": 2050,
      "turn_loss": 0.32319357991218567,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.0952889797435421,
      "grad_norm": 0.9666454195976257,
      "learning_rate": 9.362803029405712e-06,
      "loss": 0.2247,
      "mae_dtheta": 0.033488672226667404,
      "mae_dx": 0.008921492844820023,
      "mae_dy": 0.0032202249858528376,
      "pose_mae_dtheta": 0.27091994881629944,
      "pose_mae_dx": 0.06368730217218399,
      "pose_mae_dy": 0.03161551058292389,
      "pose_rmse_dtheta": 0.49257585406303406,
      "pose_rmse_dx": 0.13865090906620026,
      "pose_rmse_dy": 0.08820158243179321,
      "pose_rmse_mean": 0.23980945348739624,
      "rmse_dtheta": 0.05414062365889549,
      "rmse_dx": 0.0189486313611269,
      "rmse_dy": 0.0070671518333256245,
      "rmse_mean": 0.026718802750110626,
      "rotation_flip": 0.02195608802139759,
      "sparse_tokens": 8721.0,
      "step": 2051,
      "turn_loss": 0.18526321649551392,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.09533543950938488,
      "grad_norm": 0.5176666378974915,
      "learning_rate": 9.362156965054618e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.02757231891155243,
      "mae_dx": 0.007650976534932852,
      "mae_dy": 0.002993521746248007,
      "pose_mae_dtheta": 0.2144187092781067,
      "pose_mae_dx": 0.0530695766210556,
      "pose_mae_dy": 0.03669799119234085,
      "pose_rmse_dtheta": 0.4117942154407501,
      "pose_rmse_dx": 0.12733767926692963,
      "pose_rmse_dy": 0.09428327530622482,
      "pose_rmse_mean": 0.21113839745521545,
      "rmse_dtheta": 0.046137355268001556,
      "rmse_dx": 0.0178985632956028,
      "rmse_dy": 0.005946713034063578,
      "rmse_mean": 0.023327544331550598,
      "rotation_flip": 0.005319148767739534,
      "sparse_tokens": 10665.0,
      "step": 2052,
      "turn_loss": 0.19626682996749878,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.09538189927522765,
      "grad_norm": 0.6617739796638489,
      "learning_rate": 9.361510595655545e-06,
      "loss": 0.1445,
      "mae_dtheta": 0.01071271114051342,
      "mae_dx": 0.002887437352910638,
      "mae_dy": 0.002298186533153057,
      "pose_mae_dtheta": 0.0754394605755806,
      "pose_mae_dx": 0.025082407519221306,
      "pose_mae_dy": 0.028621738776564598,
      "pose_rmse_dtheta": 0.20943832397460938,
      "pose_rmse_dx": 0.07245177030563354,
      "pose_rmse_dy": 0.07664406299591064,
      "pose_rmse_mean": 0.11951138824224472,
      "rmse_dtheta": 0.024584529921412468,
      "rmse_dx": 0.00947943702340126,
      "rmse_dy": 0.005397439002990723,
      "rmse_mean": 0.013153801672160625,
      "rotation_flip": 0.003673469414934516,
      "sparse_tokens": 32137.0,
      "step": 2053,
      "turn_loss": 0.08533211052417755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.09542835904107043,
      "grad_norm": 0.7603190541267395,
      "learning_rate": 9.360863921253695e-06,
      "loss": 0.1941,
      "mae_dtheta": 0.011736243963241577,
      "mae_dx": 0.0022742373403161764,
      "mae_dy": 0.003168066730722785,
      "pose_mae_dtheta": 0.0791311040520668,
      "pose_mae_dx": 0.03346680849790573,
      "pose_mae_dy": 0.03783733397722244,
      "pose_rmse_dtheta": 0.1879967302083969,
      "pose_rmse_dx": 0.09171347320079803,
      "pose_rmse_dy": 0.09156375378370285,
      "pose_rmse_mean": 0.1237579882144928,
      "rmse_dtheta": 0.026037126779556274,
      "rmse_dx": 0.006939098238945007,
      "rmse_dy": 0.007497597485780716,
      "rmse_mean": 0.013491274788975716,
      "rotation_flip": 0.0019455252913758159,
      "sparse_tokens": 32057.0,
      "step": 2054,
      "turn_loss": 0.09739679098129272,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16835.0,
      "epoch": 0.09547481880691322,
      "grad_norm": 1.2693508863449097,
      "learning_rate": 9.36021694189429e-06,
      "loss": 0.3064,
      "mae_dtheta": 0.027546310797333717,
      "mae_dx": 0.014718253165483475,
      "mae_dy": 0.00445141177624464,
      "pose_mae_dtheta": 0.20096208155155182,
      "pose_mae_dx": 0.12574881315231323,
      "pose_mae_dy": 0.060110099613666534,
      "pose_rmse_dtheta": 0.3251131772994995,
      "pose_rmse_dx": 0.27990472316741943,
      "pose_rmse_dy": 0.14548608660697937,
      "pose_rmse_mean": 0.2501680254936218,
      "rmse_dtheta": 0.041850496083498,
      "rmse_dx": 0.02873358130455017,
      "rmse_dy": 0.009261248633265495,
      "rmse_mean": 0.02661510929465294,
      "rotation_flip": 0.015463917516171932,
      "sparse_tokens": 13040.0,
      "step": 2055,
      "turn_loss": 0.27206727862358093,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 30818.0,
      "epoch": 0.095521278572756,
      "grad_norm": 0.6152730584144592,
      "learning_rate": 9.359569657622573e-06,
      "loss": 0.149,
      "mae_dtheta": 0.029698578640818596,
      "mae_dx": 0.008298291824758053,
      "mae_dy": 0.003657330758869648,
      "pose_mae_dtheta": 0.20413799583911896,
      "pose_mae_dx": 0.05824693664908409,
      "pose_mae_dy": 0.039642054587602615,
      "pose_rmse_dtheta": 0.3748394250869751,
      "pose_rmse_dx": 0.15054041147232056,
      "pose_rmse_dy": 0.11813553422689438,
      "pose_rmse_mean": 0.2145051211118698,
      "rmse_dtheta": 0.04726223275065422,
      "rmse_dx": 0.018806202337145805,
      "rmse_dy": 0.009162728674709797,
      "rmse_mean": 0.025077056139707565,
      "rotation_flip": 0.016005566343665123,
      "sparse_tokens": 24691.0,
      "step": 2056,
      "turn_loss": 0.24973763525485992,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 13607.0,
      "epoch": 0.09556773833859877,
      "grad_norm": 0.7936770915985107,
      "learning_rate": 9.358922068483813e-06,
      "loss": 0.1482,
      "mae_dtheta": 0.030787207186222076,
      "mae_dx": 0.008304051123559475,
      "mae_dy": 0.0021429939661175013,
      "pose_mae_dtheta": 0.2634596824645996,
      "pose_mae_dx": 0.06438075006008148,
      "pose_mae_dy": 0.037852078676223755,
      "pose_rmse_dtheta": 0.5557504296302795,
      "pose_rmse_dx": 0.18745696544647217,
      "pose_rmse_dy": 0.09626597911119461,
      "pose_rmse_mean": 0.27982446551322937,
      "rmse_dtheta": 0.05601213499903679,
      "rmse_dx": 0.021091558039188385,
      "rmse_dy": 0.004057877231389284,
      "rmse_mean": 0.02705385535955429,
      "rotation_flip": 0.013761468231678009,
      "sparse_tokens": 11070.0,
      "step": 2057,
      "turn_loss": 0.2041713446378708,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.09561419810444155,
      "grad_norm": 0.48342132568359375,
      "learning_rate": 9.358274174523292e-06,
      "loss": 0.1,
      "mae_dtheta": 0.018823547288775444,
      "mae_dx": 0.006480734329670668,
      "mae_dy": 0.008005849085748196,
      "pose_mae_dtheta": 0.15199007093906403,
      "pose_mae_dx": 0.08785121142864227,
      "pose_mae_dy": 0.08140486478805542,
      "pose_rmse_dtheta": 0.2154945433139801,
      "pose_rmse_dx": 0.19030407071113586,
      "pose_rmse_dy": 0.15373468399047852,
      "pose_rmse_mean": 0.1865110993385315,
      "rmse_dtheta": 0.02773434855043888,
      "rmse_dx": 0.014416784048080444,
      "rmse_dy": 0.014678184874355793,
      "rmse_mean": 0.01894310489296913,
      "rotation_flip": 0.0,
      "sparse_tokens": 2648.0,
      "step": 2058,
      "turn_loss": 0.2480909824371338,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09566065787028433,
      "grad_norm": 0.5720599293708801,
      "learning_rate": 9.357625975786318e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.010185196995735168,
      "mae_dx": 0.0019248716998845339,
      "mae_dy": 0.0024885961320251226,
      "pose_mae_dtheta": 0.07230101525783539,
      "pose_mae_dx": 0.02872888371348381,
      "pose_mae_dy": 0.03186522424221039,
      "pose_rmse_dtheta": 0.18062156438827515,
      "pose_rmse_dx": 0.08352929353713989,
      "pose_rmse_dy": 0.08274862915277481,
      "pose_rmse_mean": 0.11563315987586975,
      "rmse_dtheta": 0.02330819144845009,
      "rmse_dx": 0.005496824160218239,
      "rmse_dy": 0.005803688429296017,
      "rmse_mean": 0.011536234989762306,
      "rotation_flip": 0.0017929179593920708,
      "sparse_tokens": 32073.0,
      "step": 2059,
      "turn_loss": 0.08915262669324875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.09570711763612712,
      "grad_norm": 0.47105610370635986,
      "learning_rate": 9.35697747231822e-06,
      "loss": 0.0881,
      "mae_dtheta": 0.00839865393936634,
      "mae_dx": 0.0020542701240628958,
      "mae_dy": 0.001325213466770947,
      "pose_mae_dtheta": 0.06126273050904274,
      "pose_mae_dx": 0.02302846685051918,
      "pose_mae_dy": 0.021061275154352188,
      "pose_rmse_dtheta": 0.17938296496868134,
      "pose_rmse_dx": 0.059363044798374176,
      "pose_rmse_dy": 0.05634578689932823,
      "pose_rmse_mean": 0.09836393594741821,
      "rmse_dtheta": 0.02222457155585289,
      "rmse_dx": 0.00608088867738843,
      "rmse_dy": 0.0030286693945527077,
      "rmse_mean": 0.010444710031151772,
      "rotation_flip": 0.0014333492144942284,
      "sparse_tokens": 32137.0,
      "step": 2060,
      "turn_loss": 0.06398497521877289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.0957535774019699,
      "grad_norm": 0.8134349584579468,
      "learning_rate": 9.35632866416435e-06,
      "loss": 0.2182,
      "mae_dtheta": 0.03468095511198044,
      "mae_dx": 0.010923914611339569,
      "mae_dy": 0.003693157806992531,
      "pose_mae_dtheta": 0.30053645372390747,
      "pose_mae_dx": 0.08909334987401962,
      "pose_mae_dy": 0.03828131780028343,
      "pose_rmse_dtheta": 0.5088427662849426,
      "pose_rmse_dx": 0.20254412293434143,
      "pose_rmse_dy": 0.1453806310892105,
      "pose_rmse_mean": 0.28558918833732605,
      "rmse_dtheta": 0.053874675184488297,
      "rmse_dx": 0.022282099351286888,
      "rmse_dy": 0.008905124850571156,
      "rmse_mean": 0.028353966772556305,
      "rotation_flip": 0.0060240961611270905,
      "sparse_tokens": 13215.0,
      "step": 2061,
      "turn_loss": 0.3127579689025879,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.09580003716781267,
      "grad_norm": 0.5530601739883423,
      "learning_rate": 9.355679551370078e-06,
      "loss": 0.1131,
      "mae_dtheta": 0.039221715182065964,
      "mae_dx": 0.010631037876009941,
      "mae_dy": 0.008538292720913887,
      "pose_mae_dtheta": 0.2779960632324219,
      "pose_mae_dx": 0.07777058333158493,
      "pose_mae_dy": 0.09769332408905029,
      "pose_rmse_dtheta": 0.49913978576660156,
      "pose_rmse_dx": 0.13877132534980774,
      "pose_rmse_dy": 0.2008093297481537,
      "pose_rmse_mean": 0.2795735001564026,
      "rmse_dtheta": 0.05715158209204674,
      "rmse_dx": 0.020875196903944016,
      "rmse_dy": 0.015605294145643711,
      "rmse_mean": 0.03121069073677063,
      "rotation_flip": 0.011976048350334167,
      "sparse_tokens": 5563.0,
      "step": 2062,
      "turn_loss": 0.2835489809513092,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.09584649693365545,
      "grad_norm": 0.8755385875701904,
      "learning_rate": 9.355030133980798e-06,
      "loss": 0.2018,
      "mae_dtheta": 0.03286334127187729,
      "mae_dx": 0.008282973431050777,
      "mae_dy": 0.0047559286467731,
      "pose_mae_dtheta": 0.24674072861671448,
      "pose_mae_dx": 0.07676525413990021,
      "pose_mae_dy": 0.07588636130094528,
      "pose_rmse_dtheta": 0.45236462354660034,
      "pose_rmse_dx": 0.15872181951999664,
      "pose_rmse_dy": 0.1709841787815094,
      "pose_rmse_mean": 0.26069021224975586,
      "rmse_dtheta": 0.0534655824303627,
      "rmse_dx": 0.019126908853650093,
      "rmse_dy": 0.008597285486757755,
      "rmse_mean": 0.02706325799226761,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 7905.0,
      "step": 2063,
      "turn_loss": 0.22007940709590912,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09589295669949824,
      "grad_norm": 0.5161484479904175,
      "learning_rate": 9.354380412041922e-06,
      "loss": 0.1271,
      "mae_dtheta": 0.00921854842454195,
      "mae_dx": 0.001600639894604683,
      "mae_dy": 0.0019291352946311235,
      "pose_mae_dtheta": 0.07338734716176987,
      "pose_mae_dx": 0.021153775975108147,
      "pose_mae_dy": 0.03192402794957161,
      "pose_rmse_dtheta": 0.18567056953907013,
      "pose_rmse_dx": 0.05605778843164444,
      "pose_rmse_dy": 0.08791390061378479,
      "pose_rmse_mean": 0.10988076031208038,
      "rmse_dtheta": 0.020726392045617104,
      "rmse_dx": 0.00531926192343235,
      "rmse_dy": 0.004476862959563732,
      "rmse_mean": 0.010174172930419445,
      "rotation_flip": 0.00522193219512701,
      "sparse_tokens": 32073.0,
      "step": 2064,
      "turn_loss": 0.07234282791614532,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.09593941646534102,
      "grad_norm": 0.5277945399284363,
      "learning_rate": 9.353730385598887e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.03589997440576553,
      "mae_dx": 0.006021837703883648,
      "mae_dy": 0.007271541748195887,
      "pose_mae_dtheta": 0.2460702806711197,
      "pose_mae_dx": 0.06607527285814285,
      "pose_mae_dy": 0.06198485940694809,
      "pose_rmse_dtheta": 0.5244801044464111,
      "pose_rmse_dx": 0.1498297154903412,
      "pose_rmse_dy": 0.11965575814247131,
      "pose_rmse_mean": 0.264655202627182,
      "rmse_dtheta": 0.05796687304973602,
      "rmse_dx": 0.013555280864238739,
      "rmse_dy": 0.013803049921989441,
      "rmse_mean": 0.028441734611988068,
      "rotation_flip": 0.016129031777381897,
      "sparse_tokens": 3936.0,
      "step": 2065,
      "turn_loss": 0.3126303553581238,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 13284.0,
      "epoch": 0.09598587623118379,
      "grad_norm": 0.9319589734077454,
      "learning_rate": 9.35308005469715e-06,
      "loss": 0.2885,
      "mae_dtheta": 0.03813496604561806,
      "mae_dx": 0.014777772128582,
      "mae_dy": 0.0037224995903670788,
      "pose_mae_dtheta": 0.3435845673084259,
      "pose_mae_dx": 0.11112691462039948,
      "pose_mae_dy": 0.05111415684223175,
      "pose_rmse_dtheta": 0.515078604221344,
      "pose_rmse_dx": 0.2341078519821167,
      "pose_rmse_dy": 0.1185259222984314,
      "pose_rmse_mean": 0.28923746943473816,
      "rmse_dtheta": 0.053241051733493805,
      "rmse_dx": 0.027367696166038513,
      "rmse_dy": 0.006629467476159334,
      "rmse_mean": 0.029079405590891838,
      "rotation_flip": 0.018691588193178177,
      "sparse_tokens": 10219.0,
      "step": 2066,
      "turn_loss": 0.31272169947624207,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.09603233599702657,
      "grad_norm": 0.44320032000541687,
      "learning_rate": 9.352429419382187e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.048001933842897415,
      "mae_dx": 0.023648949339985847,
      "mae_dy": 0.00793306902050972,
      "pose_mae_dtheta": 0.3502516746520996,
      "pose_mae_dx": 0.19221077859401703,
      "pose_mae_dy": 0.11812795698642731,
      "pose_rmse_dtheta": 0.5407994985580444,
      "pose_rmse_dx": 0.36888962984085083,
      "pose_rmse_dy": 0.23914478719234467,
      "pose_rmse_mean": 0.38294464349746704,
      "rmse_dtheta": 0.0653616264462471,
      "rmse_dx": 0.03842003270983696,
      "rmse_dy": 0.01251518540084362,
      "rmse_mean": 0.038765616714954376,
      "rotation_flip": 0.029411764815449715,
      "sparse_tokens": 4659.0,
      "step": 2067,
      "turn_loss": 0.3374354839324951,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.09607879576286936,
      "grad_norm": 0.4477045238018036,
      "learning_rate": 9.351778479699499e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.012239182367920876,
      "mae_dx": 0.0021708961576223373,
      "mae_dy": 0.003028183476999402,
      "pose_mae_dtheta": 0.08400837332010269,
      "pose_mae_dx": 0.026449130848050117,
      "pose_mae_dy": 0.03518148884177208,
      "pose_rmse_dtheta": 0.21911990642547607,
      "pose_rmse_dx": 0.07633502781391144,
      "pose_rmse_dy": 0.08309252560138702,
      "pose_rmse_mean": 0.12618248164653778,
      "rmse_dtheta": 0.026663361117243767,
      "rmse_dx": 0.0074013397097587585,
      "rmse_dy": 0.0070120180025696754,
      "rmse_mean": 0.013692240230739117,
      "rotation_flip": 0.0064073228277266026,
      "sparse_tokens": 32025.0,
      "step": 2068,
      "turn_loss": 0.09950999915599823,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.09612525552871214,
      "grad_norm": 0.633267343044281,
      "learning_rate": 9.351127235694607e-06,
      "loss": 0.1892,
      "mae_dtheta": 0.03112282045185566,
      "mae_dx": 0.009445748291909695,
      "mae_dy": 0.007442181464284658,
      "pose_mae_dtheta": 0.22543048858642578,
      "pose_mae_dx": 0.08532365411520004,
      "pose_mae_dy": 0.09095977991819382,
      "pose_rmse_dtheta": 0.39636537432670593,
      "pose_rmse_dx": 0.2007032036781311,
      "pose_rmse_dy": 0.19915828108787537,
      "pose_rmse_mean": 0.2654089629650116,
      "rmse_dtheta": 0.047745537012815475,
      "rmse_dx": 0.0217908825725317,
      "rmse_dy": 0.014832474291324615,
      "rmse_mean": 0.02812296524643898,
      "rotation_flip": 0.012560386210680008,
      "sparse_tokens": 17119.0,
      "step": 2069,
      "turn_loss": 0.27633196115493774,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.09617171529455491,
      "grad_norm": 0.279888391494751,
      "learning_rate": 9.350475687413052e-06,
      "loss": 0.0673,
      "mae_dtheta": 0.008483071811497211,
      "mae_dx": 0.0017172477673739195,
      "mae_dy": 0.001699241460300982,
      "pose_mae_dtheta": 0.059251490980386734,
      "pose_mae_dx": 0.02313539944589138,
      "pose_mae_dy": 0.026751145720481873,
      "pose_rmse_dtheta": 0.1135709211230278,
      "pose_rmse_dx": 0.055521707981824875,
      "pose_rmse_dy": 0.0671263188123703,
      "pose_rmse_mean": 0.07873965054750443,
      "rmse_dtheta": 0.01635138690471649,
      "rmse_dx": 0.005288389045745134,
      "rmse_dy": 0.003674471518024802,
      "rmse_mean": 0.008438082411885262,
      "rotation_flip": 0.002533783670514822,
      "sparse_tokens": 32105.0,
      "step": 2070,
      "turn_loss": 0.06591612100601196,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.09621817506039769,
      "grad_norm": 0.6099266409873962,
      "learning_rate": 9.349823834900396e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.039514508098363876,
      "mae_dx": 0.00974136870354414,
      "mae_dy": 0.004747041035443544,
      "pose_mae_dtheta": 0.307151734828949,
      "pose_mae_dx": 0.05133356526494026,
      "pose_mae_dy": 0.056087881326675415,
      "pose_rmse_dtheta": 0.5279545187950134,
      "pose_rmse_dx": 0.1184561625123024,
      "pose_rmse_dy": 0.1615598052740097,
      "pose_rmse_mean": 0.26932352781295776,
      "rmse_dtheta": 0.05967998504638672,
      "rmse_dx": 0.020307345315814018,
      "rmse_dy": 0.01165691763162613,
      "rmse_mean": 0.030548084527254105,
      "rotation_flip": 0.009198423475027084,
      "sparse_tokens": 11667.0,
      "step": 2071,
      "turn_loss": 0.2855958640575409,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.09626463482624048,
      "grad_norm": 0.31932124495506287,
      "learning_rate": 9.349171678202224e-06,
      "loss": 0.0704,
      "mae_dtheta": 0.010307684540748596,
      "mae_dx": 0.0018428654875606298,
      "mae_dy": 0.00038950410089455545,
      "pose_mae_dtheta": 0.0780547559261322,
      "pose_mae_dx": 0.015146332792937756,
      "pose_mae_dy": 0.004594515077769756,
      "pose_rmse_dtheta": 0.29898035526275635,
      "pose_rmse_dx": 0.03575455769896507,
      "pose_rmse_dy": 0.01392359472811222,
      "pose_rmse_mean": 0.11621950566768646,
      "rmse_dtheta": 0.033514901995658875,
      "rmse_dx": 0.0048749507404863834,
      "rmse_dy": 0.0008116599638015032,
      "rmse_mean": 0.013067170977592468,
      "rotation_flip": 0.0,
      "sparse_tokens": 32217.0,
      "step": 2072,
      "turn_loss": 0.0541222020983696,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09631109459208326,
      "grad_norm": 0.45491430163383484,
      "learning_rate": 9.348519217364145e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.008045046590268612,
      "mae_dx": 0.002285740105435252,
      "mae_dy": 0.0014267427613958716,
      "pose_mae_dtheta": 0.06081294268369675,
      "pose_mae_dx": 0.022711072117090225,
      "pose_mae_dy": 0.023056238889694214,
      "pose_rmse_dtheta": 0.16740670800209045,
      "pose_rmse_dx": 0.07267887890338898,
      "pose_rmse_dy": 0.06138620525598526,
      "pose_rmse_mean": 0.10049059987068176,
      "rmse_dtheta": 0.019861670210957527,
      "rmse_dx": 0.00704171322286129,
      "rmse_dy": 0.003544761333614588,
      "rmse_mean": 0.010149382054805756,
      "rotation_flip": 0.0006153846043162048,
      "sparse_tokens": 32089.0,
      "step": 2073,
      "turn_loss": 0.06463171541690826,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 40763.0,
      "epoch": 0.09635755435792603,
      "grad_norm": 0.5321524739265442,
      "learning_rate": 9.34786645243178e-06,
      "loss": 0.1565,
      "mae_dtheta": 0.03338970988988876,
      "mae_dx": 0.013537799008190632,
      "mae_dy": 0.004296293016523123,
      "pose_mae_dtheta": 0.2818497121334076,
      "pose_mae_dx": 0.11459795385599136,
      "pose_mae_dy": 0.05946444720029831,
      "pose_rmse_dtheta": 0.4877987802028656,
      "pose_rmse_dx": 0.25301527976989746,
      "pose_rmse_dy": 0.14760343730449677,
      "pose_rmse_mean": 0.2961391806602478,
      "rmse_dtheta": 0.05166040360927582,
      "rmse_dx": 0.02668200619518757,
      "rmse_dy": 0.009155022911727428,
      "rmse_mean": 0.029165809974074364,
      "rotation_flip": 0.008441193029284477,
      "sparse_tokens": 29963.0,
      "step": 2074,
      "turn_loss": 0.2632847726345062,
      "turns": 126.0,
      "turns_per_sample": 126.0
    },
    {
      "dense_tokens": 32438.0,
      "epoch": 0.09640401412376881,
      "grad_norm": 0.563926637172699,
      "learning_rate": 9.347213383450783e-06,
      "loss": 0.1508,
      "mae_dtheta": 0.032001204788684845,
      "mae_dx": 0.008659837767481804,
      "mae_dy": 0.004770927131175995,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5639263987541199,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.9964599609375,
      "model/head/act_norm_mean": 101.499365234375,
      "model/head/act_norm_min": 62.653846740722656,
      "model/head/act_over_embed": 69.75131404109129,
      "model/head/grad_frac": 0.0831238403916359,
      "model/head/grad_norm": 0.0468757264316082,
      "model/head/grad_zero_frac": 0.00020051575847901404,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.677109375,
      "model/head/update_ratio": 0.0008127494365908206,
      "model/head/weight_delta": 5.21559476852417,
      "model/head/weight_delta_rel": 0.09149698168039322,
      "model/head/weight_norm": 57.67549514770508,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41421082615852356,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41415473258141244,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4141128361225128,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28461100960764213,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10076570510864258,
      "model/modality_embedder.encoders.pose/grad_norm": 0.056824441999197006,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5092821782178217,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001847247825935483,
      "model/modality_embedder.encoders.pose/weight_delta": 1.6894034147262573,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.055198073387145996,
      "model/modality_embedder.encoders.pose/weight_norm": 30.761676788330078,
      "model/modality_embedder/grad_frac": 0.10076570510864258,
      "model/modality_embedder/grad_norm": 0.056824441999197006,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5092821782178217,
      "model/modality_embedder/update_ratio": 0.001847247825935483,
      "model/modality_embedder/weight_delta": 1.6894034147262573,
      "model/modality_embedder/weight_delta_rel": 0.055198073387145996,
      "model/modality_embedder/weight_norm": 30.761676788330078,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.4100112915039,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.62795634920635,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.069159507751465,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.550143449439638,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06952992081642151,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0392097570002079,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014202439924702048,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.0369819402694702,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03778824582695961,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.60776138305664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.18709564208984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.580605158730158,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.761295318603516,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.20481263018307,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06796261668205261,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03832591325044632,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013138187350705266,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.2918676137924194,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.044751305133104324,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.171384811401367,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.16148376464844,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.326287202380954,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.627561569213867,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.404461673912685,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07184665650129318,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04051622748374939,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013457516906782985,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.3765482902526855,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04622191563248634,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.106761932373047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.99620819091797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.296195436507936,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.679974555969238,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.7582010549762,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09306927025318146,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.052484218031167984,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017793368315324187,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.1763499975204468,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0402020588517189,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.496505737304688,
      "model/normalizer/grad_frac": 0.3567536771297455,
      "model/normalizer/grad_norm": 0.20118281245231628,
      "model/normalizer/grad_zero_frac": 0.0002079859550576657,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002579781226813793,
      "model/normalizer/weight_delta": 2.5134782791137695,
      "model/normalizer/weight_delta_rel": 0.03237214311957359,
      "model/normalizer/weight_norm": 77.98444366455078,
      "pose_mae_dtheta": 0.22459791600704193,
      "pose_mae_dx": 0.06664282083511353,
      "pose_mae_dy": 0.05598663538694382,
      "pose_rmse_dtheta": 0.4156075119972229,
      "pose_rmse_dx": 0.14567261934280396,
      "pose_rmse_dy": 0.13678209483623505,
      "pose_rmse_mean": 0.23268741369247437,
      "rmse_dtheta": 0.05095117911696434,
      "rmse_dx": 0.01915753446519375,
      "rmse_dy": 0.009306707419455051,
      "rmse_mean": 0.026471806690096855,
      "rotation_flip": 0.010883483104407787,
      "sparse_tokens": 25649.0,
      "step": 2075,
      "turn_loss": 0.2615756392478943,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.0964504738896116,
      "grad_norm": 0.6789278984069824,
      "learning_rate": 9.34656001046682e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.011778471991419792,
      "mae_dx": 0.0027512311935424805,
      "mae_dy": 0.0032479215878993273,
      "pose_mae_dtheta": 0.0870455726981163,
      "pose_mae_dx": 0.03473847359418869,
      "pose_mae_dy": 0.042875561863183975,
      "pose_rmse_dtheta": 0.22931136190891266,
      "pose_rmse_dx": 0.09221463650465012,
      "pose_rmse_dy": 0.14049461483955383,
      "pose_rmse_mean": 0.15400686860084534,
      "rmse_dtheta": 0.026598278433084488,
      "rmse_dx": 0.008352328091859818,
      "rmse_dy": 0.00883509498089552,
      "rmse_mean": 0.014595234766602516,
      "rotation_flip": 0.006407096982002258,
      "sparse_tokens": 32057.0,
      "step": 2076,
      "turn_loss": 0.11061950773000717,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.09649693365545438,
      "grad_norm": 0.4440726339817047,
      "learning_rate": 9.345906333525582e-06,
      "loss": 0.1341,
      "mae_dtheta": 0.009709630161523819,
      "mae_dx": 0.0021072975359857082,
      "mae_dy": 0.0027069232892245054,
      "pose_mae_dtheta": 0.07620684057474136,
      "pose_mae_dx": 0.03171020746231079,
      "pose_mae_dy": 0.034839943051338196,
      "pose_rmse_dtheta": 0.16444434225559235,
      "pose_rmse_dx": 0.08565345406532288,
      "pose_rmse_dy": 0.08267215639352798,
      "pose_rmse_mean": 0.11092332005500793,
      "rmse_dtheta": 0.019558656960725784,
      "rmse_dx": 0.006882477551698685,
      "rmse_dy": 0.006048325449228287,
      "rmse_mean": 0.010829820297658443,
      "rotation_flip": 0.0038944180123507977,
      "sparse_tokens": 32057.0,
      "step": 2077,
      "turn_loss": 0.08887264877557755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.09654339342129716,
      "grad_norm": 0.4854549169540405,
      "learning_rate": 9.345252352672781e-06,
      "loss": 0.0803,
      "mae_dtheta": 0.010296233929693699,
      "mae_dx": 0.0014702945481985807,
      "mae_dy": 0.002206123434007168,
      "pose_mae_dtheta": 0.0720168724656105,
      "pose_mae_dx": 0.020972153171896935,
      "pose_mae_dy": 0.03653649985790253,
      "pose_rmse_dtheta": 0.1411532461643219,
      "pose_rmse_dx": 0.05136369168758392,
      "pose_rmse_dy": 0.08752371370792389,
      "pose_rmse_mean": 0.09334688633680344,
      "rmse_dtheta": 0.018707968294620514,
      "rmse_dx": 0.004714403301477432,
      "rmse_dy": 0.00436059245839715,
      "rmse_mean": 0.009260987862944603,
      "rotation_flip": 0.003280032891780138,
      "sparse_tokens": 32057.0,
      "step": 2078,
      "turn_loss": 0.07802467793226242,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09658985318713993,
      "grad_norm": 0.5492197871208191,
      "learning_rate": 9.344598067954151e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.011922127567231655,
      "mae_dx": 0.00278298556804657,
      "mae_dy": 0.003300282172858715,
      "pose_mae_dtheta": 0.08769257366657257,
      "pose_mae_dx": 0.034679580479860306,
      "pose_mae_dy": 0.04576100781559944,
      "pose_rmse_dtheta": 0.20862767100334167,
      "pose_rmse_dx": 0.09974313527345657,
      "pose_rmse_dy": 0.14961329102516174,
      "pose_rmse_mean": 0.15266136825084686,
      "rmse_dtheta": 0.025881899520754814,
      "rmse_dx": 0.008631166070699692,
      "rmse_dy": 0.009207681752741337,
      "rmse_mean": 0.014573581516742706,
      "rotation_flip": 0.006684491876512766,
      "sparse_tokens": 32073.0,
      "step": 2079,
      "turn_loss": 0.12007482349872589,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.09663631295298272,
      "grad_norm": 0.3104111850261688,
      "learning_rate": 9.343943479415447e-06,
      "loss": 0.0724,
      "mae_dtheta": 0.011987506411969662,
      "mae_dx": 0.0018062954768538475,
      "mae_dy": 0.00259377621114254,
      "pose_mae_dtheta": 0.08545154333114624,
      "pose_mae_dx": 0.02520287223160267,
      "pose_mae_dy": 0.03626706823706627,
      "pose_rmse_dtheta": 0.17979714274406433,
      "pose_rmse_dx": 0.05615632236003876,
      "pose_rmse_dy": 0.07237207144498825,
      "pose_rmse_mean": 0.10277517884969711,
      "rmse_dtheta": 0.02093437686562538,
      "rmse_dx": 0.005650182254612446,
      "rmse_dy": 0.0047011906281113625,
      "rmse_mean": 0.01042858324944973,
      "rotation_flip": 0.0022875817958265543,
      "sparse_tokens": 32105.0,
      "step": 2080,
      "turn_loss": 0.09793418645858765,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0966827727188255,
      "grad_norm": 0.5662626028060913,
      "learning_rate": 9.343288587102444e-06,
      "loss": 0.1486,
      "mae_dtheta": 0.011604753322899342,
      "mae_dx": 0.0022058209870010614,
      "mae_dy": 0.003436827566474676,
      "pose_mae_dtheta": 0.07417095452547073,
      "pose_mae_dx": 0.027005938813090324,
      "pose_mae_dy": 0.03676518797874451,
      "pose_rmse_dtheta": 0.13765209913253784,
      "pose_rmse_dx": 0.06654281169176102,
      "pose_rmse_dy": 0.07543949037790298,
      "pose_rmse_mean": 0.09321146458387375,
      "rmse_dtheta": 0.02191879227757454,
      "rmse_dx": 0.0068712676875293255,
      "rmse_dy": 0.007582406047731638,
      "rmse_mean": 0.012124156579375267,
      "rotation_flip": 0.005975395441055298,
      "sparse_tokens": 32089.0,
      "step": 2081,
      "turn_loss": 0.10740502923727036,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09672923248466828,
      "grad_norm": 0.5787713527679443,
      "learning_rate": 9.342633391060939e-06,
      "loss": 0.1494,
      "mae_dtheta": 0.013399424962699413,
      "mae_dx": 0.002069915644824505,
      "mae_dy": 0.003104740520939231,
      "pose_mae_dtheta": 0.08555014431476593,
      "pose_mae_dx": 0.028126021847128868,
      "pose_mae_dy": 0.03438613563776016,
      "pose_rmse_dtheta": 0.19328702986240387,
      "pose_rmse_dx": 0.07284393906593323,
      "pose_rmse_dy": 0.0675520971417427,
      "pose_rmse_mean": 0.11122769117355347,
      "rmse_dtheta": 0.02639428898692131,
      "rmse_dx": 0.007015698589384556,
      "rmse_dy": 0.0055803596042096615,
      "rmse_mean": 0.01299678161740303,
      "rotation_flip": 0.009931506589055061,
      "sparse_tokens": 32089.0,
      "step": 2082,
      "turn_loss": 0.1191626489162445,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09677569225051105,
      "grad_norm": 0.6218599677085876,
      "learning_rate": 9.341977891336748e-06,
      "loss": 0.0848,
      "mae_dtheta": 0.008311962708830833,
      "mae_dx": 0.0018920847214758396,
      "mae_dy": 0.0020757277961820364,
      "pose_mae_dtheta": 0.05899319797754288,
      "pose_mae_dx": 0.02517455257475376,
      "pose_mae_dy": 0.0264726672321558,
      "pose_rmse_dtheta": 0.13455481827259064,
      "pose_rmse_dx": 0.07036212831735611,
      "pose_rmse_dy": 0.06324516981840134,
      "pose_rmse_mean": 0.08938737958669662,
      "rmse_dtheta": 0.018999693915247917,
      "rmse_dx": 0.005793442018330097,
      "rmse_dy": 0.005512503907084465,
      "rmse_mean": 0.010101880878210068,
      "rotation_flip": 0.003798670368269086,
      "sparse_tokens": 32073.0,
      "step": 2083,
      "turn_loss": 0.07884246110916138,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09682215201635384,
      "grad_norm": 0.41589510440826416,
      "learning_rate": 9.341322087975715e-06,
      "loss": 0.0868,
      "mae_dtheta": 0.0123957684263587,
      "mae_dx": 0.0021718733478337526,
      "mae_dy": 0.0027905055321753025,
      "pose_mae_dtheta": 0.09120473265647888,
      "pose_mae_dx": 0.029206179082393646,
      "pose_mae_dy": 0.033790260553359985,
      "pose_rmse_dtheta": 0.2357863187789917,
      "pose_rmse_dx": 0.07630108296871185,
      "pose_rmse_dy": 0.07811238616704941,
      "pose_rmse_mean": 0.13006660342216492,
      "rmse_dtheta": 0.026626810431480408,
      "rmse_dx": 0.006347046699374914,
      "rmse_dy": 0.00579013442620635,
      "rmse_mean": 0.012921329587697983,
      "rotation_flip": 0.005397070199251175,
      "sparse_tokens": 32073.0,
      "step": 2084,
      "turn_loss": 0.09925918281078339,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.09686861178219662,
      "grad_norm": 0.6422545909881592,
      "learning_rate": 9.340665981023698e-06,
      "loss": 0.1466,
      "mae_dtheta": 0.01278731320053339,
      "mae_dx": 0.0026377500034868717,
      "mae_dy": 0.0040900930762290955,
      "pose_mae_dtheta": 0.09712819755077362,
      "pose_mae_dx": 0.045281678438186646,
      "pose_mae_dy": 0.052325040102005005,
      "pose_rmse_dtheta": 0.21427780389785767,
      "pose_rmse_dx": 0.11805640906095505,
      "pose_rmse_dy": 0.12385484576225281,
      "pose_rmse_mean": 0.1520630270242691,
      "rmse_dtheta": 0.025005148723721504,
      "rmse_dx": 0.0070244320668280125,
      "rmse_dy": 0.009598120115697384,
      "rmse_mean": 0.013875900767743587,
      "rotation_flip": 0.004739336669445038,
      "sparse_tokens": 32041.0,
      "step": 2085,
      "turn_loss": 0.13012495636940002,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.0969150715480394,
      "grad_norm": 0.4047468304634094,
      "learning_rate": 9.340009570526578e-06,
      "loss": 0.1341,
      "mae_dtheta": 0.03035893104970455,
      "mae_dx": 0.009559265337884426,
      "mae_dy": 0.004192693624645472,
      "pose_mae_dtheta": 0.23498639464378357,
      "pose_mae_dx": 0.08051018416881561,
      "pose_mae_dy": 0.0648837611079216,
      "pose_rmse_dtheta": 0.4065018892288208,
      "pose_rmse_dx": 0.20664265751838684,
      "pose_rmse_dy": 0.13119377195835114,
      "pose_rmse_mean": 0.2481127679347992,
      "rmse_dtheta": 0.04703517630696297,
      "rmse_dx": 0.021929394453763962,
      "rmse_dy": 0.007476561237126589,
      "rmse_mean": 0.025480378419160843,
      "rotation_flip": 0.013432836160063744,
      "sparse_tokens": 14472.0,
      "step": 2086,
      "turn_loss": 0.2030220776796341,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09696153131388217,
      "grad_norm": 0.5662820935249329,
      "learning_rate": 9.33935285653026e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.0077376472763717175,
      "mae_dx": 0.0017822996014729142,
      "mae_dy": 0.0017668359214439988,
      "pose_mae_dtheta": 0.052004046738147736,
      "pose_mae_dx": 0.018259404227137566,
      "pose_mae_dy": 0.0213826484978199,
      "pose_rmse_dtheta": 0.11409835517406464,
      "pose_rmse_dx": 0.0443638414144516,
      "pose_rmse_dy": 0.04736900329589844,
      "pose_rmse_mean": 0.06861039996147156,
      "rmse_dtheta": 0.01739346794784069,
      "rmse_dx": 0.005570561625063419,
      "rmse_dy": 0.00380695890635252,
      "rmse_mean": 0.008923663757741451,
      "rotation_flip": 0.003441494656726718,
      "sparse_tokens": 32089.0,
      "step": 2087,
      "turn_loss": 0.07040513306856155,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.09700799107972496,
      "grad_norm": 0.4517885446548462,
      "learning_rate": 9.338695839080667e-06,
      "loss": 0.111,
      "mae_dtheta": 0.029382705688476562,
      "mae_dx": 0.017553526908159256,
      "mae_dy": 0.005915772169828415,
      "pose_mae_dtheta": 0.24191102385520935,
      "pose_mae_dx": 0.12362858653068542,
      "pose_mae_dy": 0.09965385496616364,
      "pose_rmse_dtheta": 0.4362383484840393,
      "pose_rmse_dx": 0.26220789551734924,
      "pose_rmse_dy": 0.20195944607257843,
      "pose_rmse_mean": 0.3001352548599243,
      "rmse_dtheta": 0.04517035931348801,
      "rmse_dx": 0.03222297877073288,
      "rmse_dy": 0.009412892162799835,
      "rmse_mean": 0.02893541008234024,
      "rotation_flip": 0.0031746032182127237,
      "sparse_tokens": 6064.0,
      "step": 2088,
      "turn_loss": 0.2873404622077942,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.09705445084556774,
      "grad_norm": 0.6968252658843994,
      "learning_rate": 9.338038518223746e-06,
      "loss": 0.1947,
      "mae_dtheta": 0.03645174205303192,
      "mae_dx": 0.018783150240778923,
      "mae_dy": 0.012647516094148159,
      "pose_mae_dtheta": 0.308983713388443,
      "pose_mae_dx": 0.1465890258550644,
      "pose_mae_dy": 0.15914954245090485,
      "pose_rmse_dtheta": 0.49187517166137695,
      "pose_rmse_dx": 0.274335652589798,
      "pose_rmse_dy": 0.32935190200805664,
      "pose_rmse_mean": 0.3651875853538513,
      "rmse_dtheta": 0.051969900727272034,
      "rmse_dx": 0.03164929896593094,
      "rmse_dy": 0.023002106696367264,
      "rmse_mean": 0.03554043918848038,
      "rotation_flip": 0.004866180010139942,
      "sparse_tokens": 6559.0,
      "step": 2089,
      "turn_loss": 0.47561460733413696,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.09710091061141052,
      "grad_norm": 0.5188605785369873,
      "learning_rate": 9.337380894005463e-06,
      "loss": 0.0896,
      "mae_dtheta": 0.008996163494884968,
      "mae_dx": 0.003004817757755518,
      "mae_dy": 0.002246545162051916,
      "pose_mae_dtheta": 0.06491613388061523,
      "pose_mae_dx": 0.03168397396802902,
      "pose_mae_dy": 0.029526500031352043,
      "pose_rmse_dtheta": 0.15837372839450836,
      "pose_rmse_dx": 0.09438566118478775,
      "pose_rmse_dy": 0.08104026317596436,
      "pose_rmse_mean": 0.11126655340194702,
      "rmse_dtheta": 0.020910708233714104,
      "rmse_dx": 0.009754386730492115,
      "rmse_dy": 0.006097669713199139,
      "rmse_mean": 0.012254255823791027,
      "rotation_flip": 0.0011217050487175584,
      "sparse_tokens": 32057.0,
      "step": 2090,
      "turn_loss": 0.10740792751312256,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34607.0,
      "epoch": 0.0971473703772533,
      "grad_norm": 0.8633818030357361,
      "learning_rate": 9.336722966471806e-06,
      "loss": 0.2829,
      "mae_dtheta": 0.03473464027047157,
      "mae_dx": 0.016994331032037735,
      "mae_dy": 0.005020500626415014,
      "pose_mae_dtheta": 0.28118711709976196,
      "pose_mae_dx": 0.1327766627073288,
      "pose_mae_dy": 0.07269324362277985,
      "pose_rmse_dtheta": 0.45833316445350647,
      "pose_rmse_dx": 0.2678382694721222,
      "pose_rmse_dy": 0.16730111837387085,
      "pose_rmse_mean": 0.2978242039680481,
      "rmse_dtheta": 0.050470177084207535,
      "rmse_dx": 0.030339468270540237,
      "rmse_dy": 0.009135715663433075,
      "rmse_mean": 0.029981788247823715,
      "rotation_flip": 0.012328767217695713,
      "sparse_tokens": 27933.0,
      "step": 2091,
      "turn_loss": 0.2899998426437378,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.09719383014309609,
      "grad_norm": 0.37558016180992126,
      "learning_rate": 9.336064735668784e-06,
      "loss": 0.1227,
      "mae_dtheta": 0.038684941828250885,
      "mae_dx": 0.01073734275996685,
      "mae_dy": 0.005263459403067827,
      "pose_mae_dtheta": 0.2849428057670593,
      "pose_mae_dx": 0.08580990880727768,
      "pose_mae_dy": 0.06441398710012436,
      "pose_rmse_dtheta": 0.5369204878807068,
      "pose_rmse_dx": 0.18052423000335693,
      "pose_rmse_dy": 0.14032943546772003,
      "pose_rmse_mean": 0.2859247326850891,
      "rmse_dtheta": 0.05954326316714287,
      "rmse_dx": 0.02191261202096939,
      "rmse_dy": 0.011137433350086212,
      "rmse_mean": 0.03086443617939949,
      "rotation_flip": 0.01886792480945587,
      "sparse_tokens": 13093.0,
      "step": 2092,
      "turn_loss": 0.30984267592430115,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.09724028990893886,
      "grad_norm": 0.8851674199104309,
      "learning_rate": 9.335406201642429e-06,
      "loss": 0.1982,
      "mae_dtheta": 0.023562297224998474,
      "mae_dx": 0.008525793440639973,
      "mae_dy": 0.009582744911313057,
      "pose_mae_dtheta": 0.18310196697711945,
      "pose_mae_dx": 0.0832027718424797,
      "pose_mae_dy": 0.08242286741733551,
      "pose_rmse_dtheta": 0.340561181306839,
      "pose_rmse_dx": 0.20073840022087097,
      "pose_rmse_dy": 0.2065524160861969,
      "pose_rmse_mean": 0.24928399920463562,
      "rmse_dtheta": 0.039625298231840134,
      "rmse_dx": 0.018115386366844177,
      "rmse_dy": 0.01794389635324478,
      "rmse_mean": 0.025228193029761314,
      "rotation_flip": 0.013316423632204533,
      "sparse_tokens": 32121.0,
      "step": 2093,
      "turn_loss": 0.29866695404052734,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09728674967478164,
      "grad_norm": 0.45215508341789246,
      "learning_rate": 9.33474736443879e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.01103325467556715,
      "mae_dx": 0.0026284479536116123,
      "mae_dy": 0.0033983348403126,
      "pose_mae_dtheta": 0.07589782774448395,
      "pose_mae_dx": 0.03234601393342018,
      "pose_mae_dy": 0.034574706107378006,
      "pose_rmse_dtheta": 0.1597537100315094,
      "pose_rmse_dx": 0.08096777647733688,
      "pose_rmse_dy": 0.07183055579662323,
      "pose_rmse_mean": 0.10418401658535004,
      "rmse_dtheta": 0.021953703835606575,
      "rmse_dx": 0.007181346882134676,
      "rmse_dy": 0.007132949307560921,
      "rmse_mean": 0.01208933349698782,
      "rotation_flip": 0.0035913807805627584,
      "sparse_tokens": 32073.0,
      "step": 2094,
      "turn_loss": 0.11280545592308044,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.09733320944062442,
      "grad_norm": 0.6882639527320862,
      "learning_rate": 9.334088224103942e-06,
      "loss": 0.1519,
      "mae_dtheta": 0.037371329963207245,
      "mae_dx": 0.011661466211080551,
      "mae_dy": 0.0023145058657974005,
      "pose_mae_dtheta": 0.29349496960639954,
      "pose_mae_dx": 0.08815163373947144,
      "pose_mae_dy": 0.029058823361992836,
      "pose_rmse_dtheta": 0.5224848389625549,
      "pose_rmse_dx": 0.1891748160123825,
      "pose_rmse_dy": 0.06870310753583908,
      "pose_rmse_mean": 0.2601209282875061,
      "rmse_dtheta": 0.05681080371141434,
      "rmse_dx": 0.022213861346244812,
      "rmse_dy": 0.004362722858786583,
      "rmse_mean": 0.02779579721391201,
      "rotation_flip": 0.01610305905342102,
      "sparse_tokens": 10893.0,
      "step": 2095,
      "turn_loss": 0.20927667617797852,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.09737966920646719,
      "grad_norm": 0.5298908948898315,
      "learning_rate": 9.333428780683977e-06,
      "loss": 0.1394,
      "mae_dtheta": 0.04398094490170479,
      "mae_dx": 0.00790426041930914,
      "mae_dy": 0.002496593864634633,
      "pose_mae_dtheta": 0.4099125564098358,
      "pose_mae_dx": 0.049050457775592804,
      "pose_mae_dy": 0.0286969393491745,
      "pose_rmse_dtheta": 0.7097585201263428,
      "pose_rmse_dx": 0.11134888231754303,
      "pose_rmse_dy": 0.06184689328074455,
      "pose_rmse_mean": 0.2943181097507477,
      "rmse_dtheta": 0.06860382109880447,
      "rmse_dx": 0.015887098386883736,
      "rmse_dy": 0.00453983386978507,
      "rmse_mean": 0.02967691794037819,
      "rotation_flip": 0.0,
      "sparse_tokens": 3065.0,
      "step": 2096,
      "turn_loss": 0.19096939265727997,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.09742612897230998,
      "grad_norm": 0.48495256900787354,
      "learning_rate": 9.332769034225012e-06,
      "loss": 0.1364,
      "mae_dtheta": 0.02454218827188015,
      "mae_dx": 0.012363973073661327,
      "mae_dy": 0.0027666196692734957,
      "pose_mae_dtheta": 0.1929350644350052,
      "pose_mae_dx": 0.09940947592258453,
      "pose_mae_dy": 0.0434449166059494,
      "pose_rmse_dtheta": 0.3667021095752716,
      "pose_rmse_dx": 0.2413148581981659,
      "pose_rmse_dy": 0.10610409080982208,
      "pose_rmse_mean": 0.23804035782814026,
      "rmse_dtheta": 0.04072229191660881,
      "rmse_dx": 0.026296600699424744,
      "rmse_dy": 0.005563198123127222,
      "rmse_mean": 0.024194031953811646,
      "rotation_flip": 0.007012622896581888,
      "sparse_tokens": 15245.0,
      "step": 2097,
      "turn_loss": 0.15145333111286163,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09747258873815276,
      "grad_norm": 0.4113646149635315,
      "learning_rate": 9.332108984773183e-06,
      "loss": 0.184,
      "mae_dtheta": 0.011078908108174801,
      "mae_dx": 0.002657973440364003,
      "mae_dy": 0.002982389647513628,
      "pose_mae_dtheta": 0.0762350782752037,
      "pose_mae_dx": 0.025903476402163506,
      "pose_mae_dy": 0.03257935866713524,
      "pose_rmse_dtheta": 0.17683163285255432,
      "pose_rmse_dx": 0.07313109189271927,
      "pose_rmse_dy": 0.07555556297302246,
      "pose_rmse_mean": 0.10850609838962555,
      "rmse_dtheta": 0.02408219501376152,
      "rmse_dx": 0.009170832112431526,
      "rmse_dy": 0.007776076439768076,
      "rmse_mean": 0.013676369562745094,
      "rotation_flip": 0.00962861068546772,
      "sparse_tokens": 32073.0,
      "step": 2098,
      "turn_loss": 0.09338001161813736,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.09751904850399554,
      "grad_norm": 0.5596850514411926,
      "learning_rate": 9.331448632374647e-06,
      "loss": 0.0953,
      "mae_dtheta": 0.008502781391143799,
      "mae_dx": 0.0012434727977961302,
      "mae_dy": 0.0013090691063553095,
      "pose_mae_dtheta": 0.05847013741731644,
      "pose_mae_dx": 0.015395616181194782,
      "pose_mae_dy": 0.01977265626192093,
      "pose_rmse_dtheta": 0.16190269589424133,
      "pose_rmse_dx": 0.04201015457510948,
      "pose_rmse_dy": 0.0495920330286026,
      "pose_rmse_mean": 0.08450162410736084,
      "rmse_dtheta": 0.020860157907009125,
      "rmse_dx": 0.00427778298035264,
      "rmse_dy": 0.0028468824457377195,
      "rmse_mean": 0.009328274056315422,
      "rotation_flip": 0.0012701100204139948,
      "sparse_tokens": 32121.0,
      "step": 2099,
      "turn_loss": 0.0594959557056427,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.09756550826983831,
      "grad_norm": 0.6420182585716248,
      "learning_rate": 9.330787977075585e-06,
      "loss": 0.233,
      "mae_dtheta": 0.04127586632966995,
      "mae_dx": 0.010490826331079006,
      "mae_dy": 0.007010359317064285,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6420182585716248,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 145.60519409179688,
      "model/head/act_norm_mean": 101.55685637718024,
      "model/head/act_norm_min": 70.46312713623047,
      "model/head/act_over_embed": 69.79082249266762,
      "model/head/grad_frac": 0.12269225716590881,
      "model/head/grad_norm": 0.07877066731452942,
      "model/head/grad_zero_frac": 0.0001856039889389649,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6811864098837209,
      "model/head/update_ratio": 0.0013655917719006538,
      "model/head/weight_delta": 5.246737480163574,
      "model/head/weight_delta_rel": 0.09204331785440445,
      "model/head/weight_norm": 57.68244171142578,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4142625629901886,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4142142642628063,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4141393303871155,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2846519203364404,
      "model/modality_embedder.encoders.pose/grad_frac": 0.055672965943813324,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03574306145310402,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5510919744318182,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011618926655501127,
      "model/modality_embedder.encoders.pose/weight_delta": 1.7052512168884277,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05571587383747101,
      "model/modality_embedder.encoders.pose/weight_norm": 30.762792587280273,
      "model/modality_embedder/grad_frac": 0.055672965943813324,
      "model/modality_embedder/grad_norm": 0.03574306145310402,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5510919744318182,
      "model/modality_embedder/update_ratio": 0.0011618926655501127,
      "model/modality_embedder/weight_delta": 1.7052512168884277,
      "model/modality_embedder/weight_delta_rel": 0.05571587383747101,
      "model/modality_embedder/weight_norm": 30.762792587280273,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.16561889648438,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.693354328165373,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.102522850036621,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.595085552845804,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.12727506458759308,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.08171291649341583,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0029595799278467894,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.045390009880066,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.038094643503427505,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.60963249206543,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.66946411132812,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.600537271594686,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.483723640441895,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.218510164750956,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.12910233438014984,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.08288605511188507,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0028410316444933414,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.3045581579208374,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04519091546535492,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.174633026123047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.42979431152344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.3250017303433,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.962692260742188,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.40357828549363,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.1201356053352356,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07712925225496292,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002561502158641815,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.3899998664855957,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04667359218001366,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.110944747924805,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 75.35794830322266,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.30061254152824,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.199699401855469,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.761236530899744,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1139206737279892,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07313915342092514,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0024793827906250954,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.1886874437332153,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.04062369465827942,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.49893569946289,
      "model/normalizer/grad_frac": 0.4699181020259857,
      "model/normalizer/grad_norm": 0.3016960024833679,
      "model/normalizer/grad_zero_frac": 0.00015008078480605036,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0038684718310832977,
      "model/normalizer/weight_delta": 2.537752866744995,
      "model/normalizer/weight_delta_rel": 0.03268478810787201,
      "model/normalizer/weight_norm": 77.98841857910156,
      "pose_mae_dtheta": 0.31885823607444763,
      "pose_mae_dx": 0.0645437017083168,
      "pose_mae_dy": 0.06954016536474228,
      "pose_rmse_dtheta": 0.5771992802619934,
      "pose_rmse_dx": 0.14989222586154938,
      "pose_rmse_dy": 0.17377489805221558,
      "pose_rmse_mean": 0.3002887964248657,
      "rmse_dtheta": 0.06219179555773735,
      "rmse_dx": 0.02201051078736782,
      "rmse_dy": 0.016079556196928024,
      "rmse_mean": 0.03342729061841965,
      "rotation_flip": 0.017391303554177284,
      "sparse_tokens": 12010.0,
      "step": 2100,
      "turn_loss": 0.33331432938575745,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.0976119680356811,
      "grad_norm": 0.6594567894935608,
      "learning_rate": 9.330127018922195e-06,
      "loss": 0.1185,
      "mae_dtheta": 0.012735165655612946,
      "mae_dx": 0.002863524714484811,
      "mae_dy": 0.003162999404594302,
      "pose_mae_dtheta": 0.09384800493717194,
      "pose_mae_dx": 0.03262893110513687,
      "pose_mae_dy": 0.033424969762563705,
      "pose_rmse_dtheta": 0.21921643614768982,
      "pose_rmse_dx": 0.09987418353557587,
      "pose_rmse_dy": 0.09209004044532776,
      "pose_rmse_mean": 0.1370602250099182,
      "rmse_dtheta": 0.026803217828273773,
      "rmse_dx": 0.009564775973558426,
      "rmse_dy": 0.007990619167685509,
      "rmse_mean": 0.01478620432317257,
      "rotation_flip": 0.007698541507124901,
      "sparse_tokens": 32121.0,
      "step": 2101,
      "turn_loss": 0.11403768509626389,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.09765842780152388,
      "grad_norm": 0.5493184328079224,
      "learning_rate": 9.329465757960696e-06,
      "loss": 0.1032,
      "mae_dtheta": 0.039801906794309616,
      "mae_dx": 0.014306729659438133,
      "mae_dy": 0.005335068795830011,
      "pose_mae_dtheta": 0.3491009771823883,
      "pose_mae_dx": 0.10758373886346817,
      "pose_mae_dy": 0.0698285847902298,
      "pose_rmse_dtheta": 0.5737433433532715,
      "pose_rmse_dx": 0.21366021037101746,
      "pose_rmse_dy": 0.1644434928894043,
      "pose_rmse_mean": 0.31728237867355347,
      "rmse_dtheta": 0.05782988294959068,
      "rmse_dx": 0.026795579120516777,
      "rmse_dy": 0.009770173579454422,
      "rmse_mean": 0.03146521374583244,
      "rotation_flip": 0.008210180327296257,
      "sparse_tokens": 11215.0,
      "step": 2102,
      "turn_loss": 0.2877180874347687,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.09770488756736666,
      "grad_norm": 0.5713474154472351,
      "learning_rate": 9.328804194237335e-06,
      "loss": 0.1855,
      "mae_dtheta": 0.03188559040427208,
      "mae_dx": 0.009505492635071278,
      "mae_dy": 0.0042171115055680275,
      "pose_mae_dtheta": 0.2370048463344574,
      "pose_mae_dx": 0.07659155875444412,
      "pose_mae_dy": 0.044602539390325546,
      "pose_rmse_dtheta": 0.4672497808933258,
      "pose_rmse_dx": 0.18666863441467285,
      "pose_rmse_dy": 0.09423206746578217,
      "pose_rmse_mean": 0.24938349425792694,
      "rmse_dtheta": 0.051129300147295,
      "rmse_dx": 0.021085046231746674,
      "rmse_dy": 0.008822164498269558,
      "rmse_mean": 0.0270121730864048,
      "rotation_flip": 0.015274949371814728,
      "sparse_tokens": 18290.0,
      "step": 2103,
      "turn_loss": 0.2576560974121094,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.09775134733320943,
      "grad_norm": 0.46896782517433167,
      "learning_rate": 9.328142327798372e-06,
      "loss": 0.1491,
      "mae_dtheta": 0.009238675236701965,
      "mae_dx": 0.0019633988849818707,
      "mae_dy": 0.0021879731211811304,
      "pose_mae_dtheta": 0.06624715775251389,
      "pose_mae_dx": 0.02809571474790573,
      "pose_mae_dy": 0.029168404638767242,
      "pose_rmse_dtheta": 0.15780377388000488,
      "pose_rmse_dx": 0.0667048916220665,
      "pose_rmse_dy": 0.06065637618303299,
      "pose_rmse_mean": 0.09505501389503479,
      "rmse_dtheta": 0.0196619164198637,
      "rmse_dx": 0.005979595705866814,
      "rmse_dy": 0.004351823590695858,
      "rmse_mean": 0.009997779503464699,
      "rotation_flip": 0.001400560257025063,
      "sparse_tokens": 32057.0,
      "step": 2104,
      "turn_loss": 0.08168642222881317,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09779780709905223,
      "grad_norm": 0.5474534630775452,
      "learning_rate": 9.327480158690095e-06,
      "loss": 0.132,
      "mae_dtheta": 0.009871152229607105,
      "mae_dx": 0.0021452512592077255,
      "mae_dy": 0.0025842327158898115,
      "pose_mae_dtheta": 0.07185976952314377,
      "pose_mae_dx": 0.02473198063671589,
      "pose_mae_dy": 0.03207170218229294,
      "pose_rmse_dtheta": 0.1619180291891098,
      "pose_rmse_dx": 0.07355891913175583,
      "pose_rmse_dy": 0.09178290516138077,
      "pose_rmse_mean": 0.10908661782741547,
      "rmse_dtheta": 0.02124861441552639,
      "rmse_dx": 0.008230010978877544,
      "rmse_dy": 0.006533147767186165,
      "rmse_mean": 0.012003923766314983,
      "rotation_flip": 0.004842615220695734,
      "sparse_tokens": 32089.0,
      "step": 2105,
      "turn_loss": 0.09541551768779755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.097844266864895,
      "grad_norm": 0.6937136650085449,
      "learning_rate": 9.326817686958806e-06,
      "loss": 0.1481,
      "mae_dtheta": 0.036369021981954575,
      "mae_dx": 0.01186708826571703,
      "mae_dy": 0.00712130032479763,
      "pose_mae_dtheta": 0.28574252128601074,
      "pose_mae_dx": 0.09416496753692627,
      "pose_mae_dy": 0.07785748690366745,
      "pose_rmse_dtheta": 0.5025205016136169,
      "pose_rmse_dx": 0.22166189551353455,
      "pose_rmse_dy": 0.1722281277179718,
      "pose_rmse_mean": 0.29880350828170776,
      "rmse_dtheta": 0.05404308810830116,
      "rmse_dx": 0.023797860369086266,
      "rmse_dy": 0.014599913731217384,
      "rmse_mean": 0.03081361949443817,
      "rotation_flip": 0.02119460515677929,
      "sparse_tokens": 15803.0,
      "step": 2106,
      "turn_loss": 0.38036155700683594,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.09789072663073778,
      "grad_norm": 1.0376673936843872,
      "learning_rate": 9.326154912650834e-06,
      "loss": 0.2111,
      "mae_dtheta": 0.031925369054079056,
      "mae_dx": 0.010087145492434502,
      "mae_dy": 0.004403284750878811,
      "pose_mae_dtheta": 0.2401876300573349,
      "pose_mae_dx": 0.06051360443234444,
      "pose_mae_dy": 0.05901920050382614,
      "pose_rmse_dtheta": 0.45160606503486633,
      "pose_rmse_dx": 0.14348536729812622,
      "pose_rmse_dy": 0.18293799459934235,
      "pose_rmse_mean": 0.25934314727783203,
      "rmse_dtheta": 0.05199180543422699,
      "rmse_dx": 0.021424755454063416,
      "rmse_dy": 0.011644583195447922,
      "rmse_mean": 0.028353717178106308,
      "rotation_flip": 0.015228426083922386,
      "sparse_tokens": 6316.0,
      "step": 2107,
      "turn_loss": 0.2563321888446808,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 25233.0,
      "epoch": 0.09793718639658056,
      "grad_norm": 0.4758793115615845,
      "learning_rate": 9.325491835812528e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.03511135280132294,
      "mae_dx": 0.017549822106957436,
      "mae_dy": 0.004166115075349808,
      "pose_mae_dtheta": 0.2763656973838806,
      "pose_mae_dx": 0.14422768354415894,
      "pose_mae_dy": 0.04538566619157791,
      "pose_rmse_dtheta": 0.49688082933425903,
      "pose_rmse_dx": 0.30202996730804443,
      "pose_rmse_dy": 0.09954201430082321,
      "pose_rmse_mean": 0.2994842827320099,
      "rmse_dtheta": 0.05341261997818947,
      "rmse_dx": 0.03134915605187416,
      "rmse_dy": 0.008670449256896973,
      "rmse_mean": 0.031144075095653534,
      "rotation_flip": 0.0185528751462698,
      "sparse_tokens": 19246.0,
      "step": 2108,
      "turn_loss": 0.24926356971263885,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.09798364616242335,
      "grad_norm": 0.4352695345878601,
      "learning_rate": 9.324828456490254e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.007166718132793903,
      "mae_dx": 0.0015212729340419173,
      "mae_dy": 0.0013628354063257575,
      "pose_mae_dtheta": 0.05316298082470894,
      "pose_mae_dx": 0.019903911277651787,
      "pose_mae_dy": 0.01894376613199711,
      "pose_rmse_dtheta": 0.17584483325481415,
      "pose_rmse_dx": 0.059899426996707916,
      "pose_rmse_dy": 0.05731472373008728,
      "pose_rmse_mean": 0.09768633544445038,
      "rmse_dtheta": 0.020703837275505066,
      "rmse_dx": 0.005066195502877235,
      "rmse_dy": 0.0037701837718486786,
      "rmse_mean": 0.00984673947095871,
      "rotation_flip": 0.0029498524963855743,
      "sparse_tokens": 32057.0,
      "step": 2109,
      "turn_loss": 0.05508117377758026,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.09803010592826612,
      "grad_norm": 0.44601479172706604,
      "learning_rate": 9.324164774730406e-06,
      "loss": 0.0848,
      "mae_dtheta": 0.04724343493580818,
      "mae_dx": 0.014392942190170288,
      "mae_dy": 0.005058641545474529,
      "pose_mae_dtheta": 0.4108395576477051,
      "pose_mae_dx": 0.12948280572891235,
      "pose_mae_dy": 0.07017632573843002,
      "pose_rmse_dtheta": 0.67006915807724,
      "pose_rmse_dx": 0.25423964858055115,
      "pose_rmse_dy": 0.1632644385099411,
      "pose_rmse_mean": 0.3625243902206421,
      "rmse_dtheta": 0.06737200915813446,
      "rmse_dx": 0.027972275391221046,
      "rmse_dy": 0.011874872259795666,
      "rmse_mean": 0.0357397198677063,
      "rotation_flip": 0.018656715750694275,
      "sparse_tokens": 8663.0,
      "step": 2110,
      "turn_loss": 0.31781861186027527,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.0980765656941089,
      "grad_norm": 0.48493534326553345,
      "learning_rate": 9.323500790579395e-06,
      "loss": 0.0949,
      "mae_dtheta": 0.009272522293031216,
      "mae_dx": 0.0014316394226625562,
      "mae_dy": 0.0017654476687312126,
      "pose_mae_dtheta": 0.06599203497171402,
      "pose_mae_dx": 0.019028477370738983,
      "pose_mae_dy": 0.02751537412405014,
      "pose_rmse_dtheta": 0.1464548408985138,
      "pose_rmse_dx": 0.04414008557796478,
      "pose_rmse_dy": 0.06269446015357971,
      "pose_rmse_mean": 0.0844298005104065,
      "rmse_dtheta": 0.019530991092324257,
      "rmse_dx": 0.004495392087846994,
      "rmse_dy": 0.0034154963213950396,
      "rmse_mean": 0.009147293865680695,
      "rotation_flip": 0.006180469878017902,
      "sparse_tokens": 32089.0,
      "step": 2111,
      "turn_loss": 0.07139715552330017,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.09812302545995168,
      "grad_norm": 0.679059624671936,
      "learning_rate": 9.322836504083654e-06,
      "loss": 0.1409,
      "mae_dtheta": 0.034169916063547134,
      "mae_dx": 0.016894841566681862,
      "mae_dy": 0.004664948675781488,
      "pose_mae_dtheta": 0.2729083299636841,
      "pose_mae_dx": 0.1289963722229004,
      "pose_mae_dy": 0.058496054261922836,
      "pose_rmse_dtheta": 0.4872603714466095,
      "pose_rmse_dx": 0.2739570736885071,
      "pose_rmse_dy": 0.1527712345123291,
      "pose_rmse_mean": 0.30466291308403015,
      "rmse_dtheta": 0.051970064640045166,
      "rmse_dx": 0.0310079175978899,
      "rmse_dy": 0.009124796837568283,
      "rmse_mean": 0.03070092760026455,
      "rotation_flip": 0.01276102103292942,
      "sparse_tokens": 15066.0,
      "step": 2112,
      "turn_loss": 0.2733854055404663,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.09816948522579447,
      "grad_norm": 0.4135732054710388,
      "learning_rate": 9.322171915289635e-06,
      "loss": 0.131,
      "mae_dtheta": 0.01179367396980524,
      "mae_dx": 0.0015747499419376254,
      "mae_dy": 0.0020359607879072428,
      "pose_mae_dtheta": 0.08779442310333252,
      "pose_mae_dx": 0.023956822231411934,
      "pose_mae_dy": 0.03472631052136421,
      "pose_rmse_dtheta": 0.21603645384311676,
      "pose_rmse_dx": 0.06636480242013931,
      "pose_rmse_dy": 0.0877963975071907,
      "pose_rmse_mean": 0.12339922040700912,
      "rmse_dtheta": 0.025615237653255463,
      "rmse_dx": 0.005078576505184174,
      "rmse_dy": 0.004721565637737513,
      "rmse_mean": 0.011805127374827862,
      "rotation_flip": 0.007515657693147659,
      "sparse_tokens": 32073.0,
      "step": 2113,
      "turn_loss": 0.08595176786184311,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.09821594499163724,
      "grad_norm": 0.38366153836250305,
      "learning_rate": 9.321507024243814e-06,
      "loss": 0.107,
      "mae_dtheta": 0.010810826905071735,
      "mae_dx": 0.0023050580639392138,
      "mae_dy": 0.002095053670927882,
      "pose_mae_dtheta": 0.07543301582336426,
      "pose_mae_dx": 0.021838156506419182,
      "pose_mae_dy": 0.026900626718997955,
      "pose_rmse_dtheta": 0.19076010584831238,
      "pose_rmse_dx": 0.05790003761649132,
      "pose_rmse_dy": 0.06037842854857445,
      "pose_rmse_mean": 0.10301285982131958,
      "rmse_dtheta": 0.024737196043133736,
      "rmse_dx": 0.006941596977412701,
      "rmse_dy": 0.004850231576710939,
      "rmse_mean": 0.012176341377198696,
      "rotation_flip": 0.004308487754315138,
      "sparse_tokens": 32121.0,
      "step": 2114,
      "turn_loss": 0.08960787206888199,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.09826240475748002,
      "grad_norm": 0.5198716521263123,
      "learning_rate": 9.320841830992685e-06,
      "loss": 0.1108,
      "mae_dtheta": 0.009525424800813198,
      "mae_dx": 0.0021712856832891703,
      "mae_dy": 0.002083911094814539,
      "pose_mae_dtheta": 0.06753203272819519,
      "pose_mae_dx": 0.023981813341379166,
      "pose_mae_dy": 0.02552196942269802,
      "pose_rmse_dtheta": 0.13592632114887238,
      "pose_rmse_dx": 0.053210340440273285,
      "pose_rmse_dy": 0.052563440054655075,
      "pose_rmse_mean": 0.08056670427322388,
      "rmse_dtheta": 0.019030634313821793,
      "rmse_dx": 0.006198400165885687,
      "rmse_dy": 0.004410340916365385,
      "rmse_mean": 0.009879792109131813,
      "rotation_flip": 0.005973295774310827,
      "sparse_tokens": 32169.0,
      "step": 2115,
      "turn_loss": 0.08022873103618622,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.0983088645233228,
      "grad_norm": 0.7162991166114807,
      "learning_rate": 9.320176335582772e-06,
      "loss": 0.1739,
      "mae_dtheta": 0.028650576248764992,
      "mae_dx": 0.008734332397580147,
      "mae_dy": 0.004348334390670061,
      "pose_mae_dtheta": 0.21585838496685028,
      "pose_mae_dx": 0.09244011342525482,
      "pose_mae_dy": 0.05181732028722763,
      "pose_rmse_dtheta": 0.34514012932777405,
      "pose_rmse_dx": 0.2072104960680008,
      "pose_rmse_dy": 0.11463069170713425,
      "pose_rmse_mean": 0.2223271131515503,
      "rmse_dtheta": 0.044349800795316696,
      "rmse_dx": 0.019920075312256813,
      "rmse_dy": 0.010278124362230301,
      "rmse_mean": 0.024849336594343185,
      "rotation_flip": 0.012903225608170033,
      "sparse_tokens": 7593.0,
      "step": 2116,
      "turn_loss": 0.34751155972480774,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.09835532428916559,
      "grad_norm": 0.6315345168113708,
      "learning_rate": 9.319510538060607e-06,
      "loss": 0.1488,
      "mae_dtheta": 0.03156732767820358,
      "mae_dx": 0.014087961986660957,
      "mae_dy": 0.005993817001581192,
      "pose_mae_dtheta": 0.24321894347667694,
      "pose_mae_dx": 0.13153502345085144,
      "pose_mae_dy": 0.09991493076086044,
      "pose_rmse_dtheta": 0.40005066990852356,
      "pose_rmse_dx": 0.29110345244407654,
      "pose_rmse_dy": 0.19257600605487823,
      "pose_rmse_mean": 0.2945767045021057,
      "rmse_dtheta": 0.04678192734718323,
      "rmse_dx": 0.02868601493537426,
      "rmse_dy": 0.009362909011542797,
      "rmse_mean": 0.028276950120925903,
      "rotation_flip": 0.003944773226976395,
      "sparse_tokens": 10863.0,
      "step": 2117,
      "turn_loss": 0.23392271995544434,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 21682.0,
      "epoch": 0.09840178405500837,
      "grad_norm": 0.8536614775657654,
      "learning_rate": 9.318844438472751e-06,
      "loss": 0.2719,
      "mae_dtheta": 0.025208909064531326,
      "mae_dx": 0.013019709847867489,
      "mae_dy": 0.004858838394284248,
      "pose_mae_dtheta": 0.2153855562210083,
      "pose_mae_dx": 0.10423605889081955,
      "pose_mae_dy": 0.06211957708001137,
      "pose_rmse_dtheta": 0.40652307868003845,
      "pose_rmse_dx": 0.20598915219306946,
      "pose_rmse_dy": 0.14648984372615814,
      "pose_rmse_mean": 0.2530007064342499,
      "rmse_dtheta": 0.041219569742679596,
      "rmse_dx": 0.024874871596693993,
      "rmse_dy": 0.010204389691352844,
      "rmse_mean": 0.025432944297790527,
      "rotation_flip": 0.010967099107801914,
      "sparse_tokens": 18296.0,
      "step": 2118,
      "turn_loss": 0.24007396399974823,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.09844824382085114,
      "grad_norm": 0.5671463012695312,
      "learning_rate": 9.318178036865786e-06,
      "loss": 0.1417,
      "mae_dtheta": 0.027085205540060997,
      "mae_dx": 0.00703051732853055,
      "mae_dy": 0.004039575811475515,
      "pose_mae_dtheta": 0.2157285362482071,
      "pose_mae_dx": 0.06547261774539948,
      "pose_mae_dy": 0.05896640568971634,
      "pose_rmse_dtheta": 0.39441409707069397,
      "pose_rmse_dx": 0.16064412891864777,
      "pose_rmse_dy": 0.14836323261260986,
      "pose_rmse_mean": 0.2344738245010376,
      "rmse_dtheta": 0.04373437911272049,
      "rmse_dx": 0.017635762691497803,
      "rmse_dy": 0.00850675068795681,
      "rmse_mean": 0.02329229936003685,
      "rotation_flip": 0.005980861373245716,
      "sparse_tokens": 15161.0,
      "step": 2119,
      "turn_loss": 0.20923052728176117,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.09849470358669392,
      "grad_norm": 0.6611452698707581,
      "learning_rate": 9.317511333286313e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.03416932746767998,
      "mae_dx": 0.011095111258327961,
      "mae_dy": 0.0038077670615166426,
      "pose_mae_dtheta": 0.2799690365791321,
      "pose_mae_dx": 0.0881781056523323,
      "pose_mae_dy": 0.030643895268440247,
      "pose_rmse_dtheta": 0.4829540550708771,
      "pose_rmse_dx": 0.19349662959575653,
      "pose_rmse_dy": 0.06638873368501663,
      "pose_rmse_mean": 0.24761313199996948,
      "rmse_dtheta": 0.051827333867549896,
      "rmse_dx": 0.02169213816523552,
      "rmse_dy": 0.00872249249368906,
      "rmse_mean": 0.0274139866232872,
      "rotation_flip": 0.010169491171836853,
      "sparse_tokens": 14907.0,
      "step": 2120,
      "turn_loss": 0.29037392139434814,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.09854116335253671,
      "grad_norm": 0.6548684239387512,
      "learning_rate": 9.316844327780955e-06,
      "loss": 0.2379,
      "mae_dtheta": 0.03367014601826668,
      "mae_dx": 0.016398057341575623,
      "mae_dy": 0.007698166184127331,
      "pose_mae_dtheta": 0.270999014377594,
      "pose_mae_dx": 0.11936633288860321,
      "pose_mae_dy": 0.1094418540596962,
      "pose_rmse_dtheta": 0.44693270325660706,
      "pose_rmse_dx": 0.22424620389938354,
      "pose_rmse_dy": 0.19181329011917114,
      "pose_rmse_mean": 0.2876640856266022,
      "rmse_dtheta": 0.04686631262302399,
      "rmse_dx": 0.029174746945500374,
      "rmse_dy": 0.011766716837882996,
      "rmse_mean": 0.029269259423017502,
      "rotation_flip": 0.01569186896085739,
      "sparse_tokens": 11752.0,
      "step": 2121,
      "turn_loss": 0.32503440976142883,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 20710.0,
      "epoch": 0.09858762311837949,
      "grad_norm": 0.6445125341415405,
      "learning_rate": 9.316177020396358e-06,
      "loss": 0.1197,
      "mae_dtheta": 0.024991614744067192,
      "mae_dx": 0.009019086137413979,
      "mae_dy": 0.005036131013184786,
      "pose_mae_dtheta": 0.2143031358718872,
      "pose_mae_dx": 0.09693404287099838,
      "pose_mae_dy": 0.09057413786649704,
      "pose_rmse_dtheta": 0.36719927191734314,
      "pose_rmse_dx": 0.2427918016910553,
      "pose_rmse_dy": 0.19824011623859406,
      "pose_rmse_mean": 0.2694104015827179,
      "rmse_dtheta": 0.037962187081575394,
      "rmse_dx": 0.021870506927371025,
      "rmse_dy": 0.010578617453575134,
      "rmse_mean": 0.02347043715417385,
      "rotation_flip": 0.012820512987673283,
      "sparse_tokens": 15292.0,
      "step": 2122,
      "turn_loss": 0.19965216517448425,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 35363.0,
      "epoch": 0.09863408288422226,
      "grad_norm": 0.47763365507125854,
      "learning_rate": 9.315509411179182e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.031173355877399445,
      "mae_dx": 0.0131736034527421,
      "mae_dy": 0.004754544235765934,
      "pose_mae_dtheta": 0.24475476145744324,
      "pose_mae_dx": 0.10656160116195679,
      "pose_mae_dy": 0.0548783540725708,
      "pose_rmse_dtheta": 0.434621661901474,
      "pose_rmse_dx": 0.22630277276039124,
      "pose_rmse_dy": 0.12160397320985794,
      "pose_rmse_mean": 0.26084280014038086,
      "rmse_dtheta": 0.04829807206988335,
      "rmse_dx": 0.02532312460243702,
      "rmse_dy": 0.00909634493291378,
      "rmse_mean": 0.027572516351938248,
      "rotation_flip": 0.016738995909690857,
      "sparse_tokens": 29634.0,
      "step": 2123,
      "turn_loss": 0.27092069387435913,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.09868054265006504,
      "grad_norm": 0.6977145075798035,
      "learning_rate": 9.31484150017612e-06,
      "loss": 0.2103,
      "mae_dtheta": 0.010992215014994144,
      "mae_dx": 0.002832208527252078,
      "mae_dy": 0.0035516025964170694,
      "pose_mae_dtheta": 0.07376604527235031,
      "pose_mae_dx": 0.03742998465895653,
      "pose_mae_dy": 0.033496398478746414,
      "pose_rmse_dtheta": 0.1663150191307068,
      "pose_rmse_dx": 0.10708747059106827,
      "pose_rmse_dy": 0.07460968941450119,
      "pose_rmse_mean": 0.11600406467914581,
      "rmse_dtheta": 0.022476715967059135,
      "rmse_dx": 0.00791322160512209,
      "rmse_dy": 0.008478732779622078,
      "rmse_mean": 0.012956224381923676,
      "rotation_flip": 0.005052327644079924,
      "sparse_tokens": 32105.0,
      "step": 2124,
      "turn_loss": 0.10642561316490173,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.09872700241590783,
      "grad_norm": 0.6654319763183594,
      "learning_rate": 9.314173287433874e-06,
      "loss": 0.0899,
      "mae_dtheta": 0.007992240600287914,
      "mae_dx": 0.002352880546823144,
      "mae_dy": 0.0017662278842180967,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6654320359230042,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.82716369628906,
      "model/head/act_norm_mean": 120.6481415719697,
      "model/head/act_norm_min": 62.867923736572266,
      "model/head/act_over_embed": 82.91053241395494,
      "model/head/grad_frac": 0.09109888225793839,
      "model/head/grad_norm": 0.06062011420726776,
      "model/head/grad_zero_frac": 0.0001532422611489892,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6849747474747475,
      "model/head/update_ratio": 0.0010508032282814384,
      "model/head/weight_delta": 5.28010368347168,
      "model/head/weight_delta_rel": 0.09262865781784058,
      "model/head/weight_norm": 57.689308166503906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.414232075214386,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41414825572717656,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41407454013824463,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28460655865277396,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08777789771556854,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05841022729873657,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5407426992358079,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0018986150389537215,
      "model/modality_embedder.encoders.pose/weight_delta": 1.7228672504425049,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05629144236445427,
      "model/modality_embedder.encoders.pose/weight_norm": 30.764650344848633,
      "model/modality_embedder/grad_frac": 0.08777789771556854,
      "model/modality_embedder/grad_norm": 0.05841022729873657,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5407426992358079,
      "model/modality_embedder/update_ratio": 0.0018986150389537215,
      "model/modality_embedder/weight_delta": 1.7228672504425049,
      "model/modality_embedder/weight_delta_rel": 0.05629144236445427,
      "model/modality_embedder/weight_norm": 30.764650344848633,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.97630310058594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.48019380311047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.987866401672363,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.823018368682803,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09805459529161453,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06524866819381714,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002363071544095874,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.0565457344055176,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03850116580724716,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.61180305480957,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.19975280761719,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.59397045855379,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.165502548217773,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.588416113644787,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07584571093320847,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05047016590833664,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017296543810516596,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.3184754848480225,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04567302018404007,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.179336547851562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.18046569824219,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.50898368606702,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 11.990479469299316,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.904431132228183,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08337272703647614,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05547888204455376,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018422659486532211,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.4058585166931152,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0472060963511467,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.11448097229004,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.82166290283203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.324692861151195,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.312520980834961,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.152203476283148,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10262525826692581,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06829013675451279,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0023146856110543013,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.202616810798645,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.04109973460435867,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.502986907958984,
      "model/normalizer/grad_frac": 0.46839484572410583,
      "model/normalizer/grad_norm": 0.3116849362850189,
      "model/normalizer/grad_zero_frac": 0.0001394451392116025,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003996321465820074,
      "model/normalizer/weight_delta": 2.566100835800171,
      "model/normalizer/weight_delta_rel": 0.033049892634153366,
      "model/normalizer/weight_norm": 77.99295806884766,
      "pose_mae_dtheta": 0.05972493067383766,
      "pose_mae_dx": 0.023151706904172897,
      "pose_mae_dy": 0.02214944362640381,
      "pose_rmse_dtheta": 0.1429460495710373,
      "pose_rmse_dx": 0.04941679537296295,
      "pose_rmse_dy": 0.051905591040849686,
      "pose_rmse_mean": 0.08142281323671341,
      "rmse_dtheta": 0.019474104046821594,
      "rmse_dx": 0.005822580773383379,
      "rmse_dy": 0.004188130609691143,
      "rmse_mean": 0.00982827227562666,
      "rotation_flip": 0.002377555938437581,
      "sparse_tokens": 32153.0,
      "step": 2125,
      "turn_loss": 0.07778634876012802,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09877346218175061,
      "grad_norm": 0.47721827030181885,
      "learning_rate": 9.313504772999173e-06,
      "loss": 0.1231,
      "mae_dtheta": 0.009991138242185116,
      "mae_dx": 0.0022133600432425737,
      "mae_dy": 0.003444955451413989,
      "pose_mae_dtheta": 0.07170595973730087,
      "pose_mae_dx": 0.02964673936367035,
      "pose_mae_dy": 0.035667046904563904,
      "pose_rmse_dtheta": 0.16807320713996887,
      "pose_rmse_dx": 0.0819571316242218,
      "pose_rmse_dy": 0.11778435111045837,
      "pose_rmse_mean": 0.12260489910840988,
      "rmse_dtheta": 0.02147318609058857,
      "rmse_dx": 0.005791417323052883,
      "rmse_dy": 0.008781656622886658,
      "rmse_mean": 0.012015420012176037,
      "rotation_flip": 0.0062622311525046825,
      "sparse_tokens": 32089.0,
      "step": 2126,
      "turn_loss": 0.09483453631401062,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.09881992194759338,
      "grad_norm": 0.5713666677474976,
      "learning_rate": 9.312835956918771e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.03740142285823822,
      "mae_dx": 0.015698643401265144,
      "mae_dy": 0.009992571547627449,
      "pose_mae_dtheta": 0.31875312328338623,
      "pose_mae_dx": 0.10850248485803604,
      "pose_mae_dy": 0.13905557990074158,
      "pose_rmse_dtheta": 0.5007914900779724,
      "pose_rmse_dx": 0.200795978307724,
      "pose_rmse_dy": 0.27104759216308594,
      "pose_rmse_mean": 0.3242116868495941,
      "rmse_dtheta": 0.05209086090326309,
      "rmse_dx": 0.02798401564359665,
      "rmse_dy": 0.016887091100215912,
      "rmse_mean": 0.03232065588235855,
      "rotation_flip": 0.034383952617645264,
      "sparse_tokens": 5390.0,
      "step": 2127,
      "turn_loss": 0.3173847794532776,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.09886638171343616,
      "grad_norm": 0.5820099115371704,
      "learning_rate": 9.312166839239433e-06,
      "loss": 0.117,
      "mae_dtheta": 0.041997894644737244,
      "mae_dx": 0.016189241781830788,
      "mae_dy": 0.00860922783613205,
      "pose_mae_dtheta": 0.35064205527305603,
      "pose_mae_dx": 0.1455429494380951,
      "pose_mae_dy": 0.07813950628042221,
      "pose_rmse_dtheta": 0.5504152178764343,
      "pose_rmse_dx": 0.2921704947948456,
      "pose_rmse_dy": 0.16509954631328583,
      "pose_rmse_mean": 0.3358950614929199,
      "rmse_dtheta": 0.05862422659993172,
      "rmse_dx": 0.031190723180770874,
      "rmse_dy": 0.017211152240633965,
      "rmse_mean": 0.03567536920309067,
      "rotation_flip": 0.010695187374949455,
      "sparse_tokens": 5931.0,
      "step": 2128,
      "turn_loss": 0.4159482419490814,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.09891284147927895,
      "grad_norm": 0.748833179473877,
      "learning_rate": 9.311497420007955e-06,
      "loss": 0.2269,
      "mae_dtheta": 0.012564259581267834,
      "mae_dx": 0.00332883489318192,
      "mae_dy": 0.003628883045166731,
      "pose_mae_dtheta": 0.08907920122146606,
      "pose_mae_dx": 0.039070870727300644,
      "pose_mae_dy": 0.039176881313323975,
      "pose_rmse_dtheta": 0.20603999495506287,
      "pose_rmse_dx": 0.09962506592273712,
      "pose_rmse_dy": 0.10429345071315765,
      "pose_rmse_mean": 0.1366528570652008,
      "rmse_dtheta": 0.027147402986884117,
      "rmse_dx": 0.009834213182330132,
      "rmse_dy": 0.009625062346458435,
      "rmse_mean": 0.015535559505224228,
      "rotation_flip": 0.006142505910247564,
      "sparse_tokens": 32105.0,
      "step": 2129,
      "turn_loss": 0.14032308757305145,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.09895930124512173,
      "grad_norm": 0.5080931186676025,
      "learning_rate": 9.31082769927115e-06,
      "loss": 0.0735,
      "mae_dtheta": 0.010348958894610405,
      "mae_dx": 0.0020369552075862885,
      "mae_dy": 0.002314510755240917,
      "pose_mae_dtheta": 0.07155308872461319,
      "pose_mae_dx": 0.025340436026453972,
      "pose_mae_dy": 0.029392631724476814,
      "pose_rmse_dtheta": 0.14998485147953033,
      "pose_rmse_dx": 0.0664263591170311,
      "pose_rmse_dy": 0.07290763407945633,
      "pose_rmse_mean": 0.09643961489200592,
      "rmse_dtheta": 0.020623967051506042,
      "rmse_dx": 0.005995952524244785,
      "rmse_dy": 0.004997438285499811,
      "rmse_mean": 0.010539120063185692,
      "rotation_flip": 0.006351727060973644,
      "sparse_tokens": 32121.0,
      "step": 2130,
      "turn_loss": 0.08481097221374512,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.0990057610109645,
      "grad_norm": 0.5885714292526245,
      "learning_rate": 9.310157677075847e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.033977147191762924,
      "mae_dx": 0.012692534364759922,
      "mae_dy": 0.0035773899871855974,
      "pose_mae_dtheta": 0.23575028777122498,
      "pose_mae_dx": 0.10355349630117416,
      "pose_mae_dy": 0.04455571249127388,
      "pose_rmse_dtheta": 0.3885513246059418,
      "pose_rmse_dx": 0.2225787490606308,
      "pose_rmse_dy": 0.09089043736457825,
      "pose_rmse_mean": 0.2340068519115448,
      "rmse_dtheta": 0.04939030483365059,
      "rmse_dx": 0.02436921000480652,
      "rmse_dy": 0.00792117789387703,
      "rmse_mean": 0.027226895093917847,
      "rotation_flip": 0.015418502502143383,
      "sparse_tokens": 6454.0,
      "step": 2131,
      "turn_loss": 0.3607763648033142,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 32438.0,
      "epoch": 0.09905222077680728,
      "grad_norm": 0.5766943693161011,
      "learning_rate": 9.309487353468906e-06,
      "loss": 0.1543,
      "mae_dtheta": 0.030341587960720062,
      "mae_dx": 0.01366726215928793,
      "mae_dy": 0.005591129884123802,
      "pose_mae_dtheta": 0.21403662860393524,
      "pose_mae_dx": 0.11296845227479935,
      "pose_mae_dy": 0.07004407793283463,
      "pose_rmse_dtheta": 0.41307684779167175,
      "pose_rmse_dx": 0.23694705963134766,
      "pose_rmse_dy": 0.16462570428848267,
      "pose_rmse_mean": 0.27154988050460815,
      "rmse_dtheta": 0.048001840710639954,
      "rmse_dx": 0.027133049443364143,
      "rmse_dy": 0.010845796205103397,
      "rmse_mean": 0.028660228475928307,
      "rotation_flip": 0.02130492590367794,
      "sparse_tokens": 25098.0,
      "step": 2132,
      "turn_loss": 0.25204089283943176,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.09909868054265006,
      "grad_norm": 0.8165410757064819,
      "learning_rate": 9.3088167284972e-06,
      "loss": 0.1765,
      "mae_dtheta": 0.04520777612924576,
      "mae_dx": 0.014882596209645271,
      "mae_dy": 0.003399644047021866,
      "pose_mae_dtheta": 0.3647783696651459,
      "pose_mae_dx": 0.12246789783239365,
      "pose_mae_dy": 0.03587501868605614,
      "pose_rmse_dtheta": 0.6327800750732422,
      "pose_rmse_dx": 0.26363176107406616,
      "pose_rmse_dy": 0.08554171770811081,
      "pose_rmse_mean": 0.32731786370277405,
      "rmse_dtheta": 0.06621482968330383,
      "rmse_dx": 0.028342358767986298,
      "rmse_dy": 0.006643256638199091,
      "rmse_mean": 0.03373348340392113,
      "rotation_flip": 0.017142856493592262,
      "sparse_tokens": 12862.0,
      "step": 2133,
      "turn_loss": 0.3402816653251648,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.09914514030849285,
      "grad_norm": 0.6030066013336182,
      "learning_rate": 9.30814580220763e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.027323031798005104,
      "mae_dx": 0.013317291624844074,
      "mae_dy": 0.005640860181301832,
      "pose_mae_dtheta": 0.22603175044059753,
      "pose_mae_dx": 0.10155443847179413,
      "pose_mae_dy": 0.10280100256204605,
      "pose_rmse_dtheta": 0.3505614101886749,
      "pose_rmse_dx": 0.2023308277130127,
      "pose_rmse_dy": 0.18119122087955475,
      "pose_rmse_mean": 0.24469447135925293,
      "rmse_dtheta": 0.039251286536455154,
      "rmse_dx": 0.02675294317305088,
      "rmse_dy": 0.009028848260641098,
      "rmse_mean": 0.025011029094457626,
      "rotation_flip": 0.01568627543747425,
      "sparse_tokens": 4772.0,
      "step": 2134,
      "turn_loss": 0.222164586186409,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.09919160007433563,
      "grad_norm": 0.46948346495628357,
      "learning_rate": 9.30747457464711e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.01302280742675066,
      "mae_dx": 0.0020068923477083445,
      "mae_dy": 0.003327042330056429,
      "pose_mae_dtheta": 0.08493820577859879,
      "pose_mae_dx": 0.032276418060064316,
      "pose_mae_dy": 0.040715258568525314,
      "pose_rmse_dtheta": 0.16470645368099213,
      "pose_rmse_dx": 0.07932884246110916,
      "pose_rmse_dy": 0.08951234072446823,
      "pose_rmse_mean": 0.1111825555562973,
      "rmse_dtheta": 0.023440087214112282,
      "rmse_dx": 0.005457958672195673,
      "rmse_dy": 0.006802338175475597,
      "rmse_mean": 0.011900128796696663,
      "rotation_flip": 0.009126009419560432,
      "sparse_tokens": 32105.0,
      "step": 2135,
      "turn_loss": 0.1101655513048172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.0992380598401784,
      "grad_norm": 0.6274886727333069,
      "learning_rate": 9.30680304586258e-06,
      "loss": 0.1058,
      "mae_dtheta": 0.03041689470410347,
      "mae_dx": 0.00430964445695281,
      "mae_dy": 0.007015769835561514,
      "pose_mae_dtheta": 0.25815194845199585,
      "pose_mae_dx": 0.05820588022470474,
      "pose_mae_dy": 0.12922115623950958,
      "pose_rmse_dtheta": 0.40523386001586914,
      "pose_rmse_dx": 0.10115501284599304,
      "pose_rmse_dy": 0.2451307326555252,
      "pose_rmse_mean": 0.25050655007362366,
      "rmse_dtheta": 0.04485108330845833,
      "rmse_dx": 0.009648225270211697,
      "rmse_dy": 0.011033457703888416,
      "rmse_mean": 0.021844256669282913,
      "rotation_flip": 0.018237082287669182,
      "sparse_tokens": 6266.0,
      "step": 2136,
      "turn_loss": 0.3173198103904724,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 32438.0,
      "epoch": 0.09928451960602118,
      "grad_norm": 0.5324674844741821,
      "learning_rate": 9.306131215901004e-06,
      "loss": 0.1004,
      "mae_dtheta": 0.031237872317433357,
      "mae_dx": 0.006372366566210985,
      "mae_dy": 0.0046965256333351135,
      "pose_mae_dtheta": 0.2481347918510437,
      "pose_mae_dx": 0.057407062500715256,
      "pose_mae_dy": 0.039809491485357285,
      "pose_rmse_dtheta": 0.4914765954017639,
      "pose_rmse_dx": 0.14539757370948792,
      "pose_rmse_dy": 0.09582079946994781,
      "pose_rmse_mean": 0.2442316710948944,
      "rmse_dtheta": 0.05308006331324577,
      "rmse_dx": 0.015113131143152714,
      "rmse_dy": 0.011232306249439716,
      "rmse_mean": 0.026475168764591217,
      "rotation_flip": 0.015699658542871475,
      "sparse_tokens": 25714.0,
      "step": 2137,
      "turn_loss": 0.24468879401683807,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09933097937186397,
      "grad_norm": 0.4722573757171631,
      "learning_rate": 9.305459084809359e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.013946542516350746,
      "mae_dx": 0.0029722475446760654,
      "mae_dy": 0.005112142767757177,
      "pose_mae_dtheta": 0.09643964469432831,
      "pose_mae_dx": 0.048185259103775024,
      "pose_mae_dy": 0.05158011615276337,
      "pose_rmse_dtheta": 0.2038513422012329,
      "pose_rmse_dx": 0.11640084534883499,
      "pose_rmse_dy": 0.12975792586803436,
      "pose_rmse_mean": 0.1500033736228943,
      "rmse_dtheta": 0.027395835146307945,
      "rmse_dx": 0.007067952770739794,
      "rmse_dy": 0.011452152393758297,
      "rmse_mean": 0.01530531421303749,
      "rotation_flip": 0.005300353281199932,
      "sparse_tokens": 32089.0,
      "step": 2138,
      "turn_loss": 0.13917316496372223,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09937743913770675,
      "grad_norm": 0.47401487827301025,
      "learning_rate": 9.30478665263465e-06,
      "loss": 0.093,
      "mae_dtheta": 0.014393273741006851,
      "mae_dx": 0.0016643074341118336,
      "mae_dy": 0.002642260165885091,
      "pose_mae_dtheta": 0.10470093041658401,
      "pose_mae_dx": 0.023222723975777626,
      "pose_mae_dy": 0.040001288056373596,
      "pose_rmse_dtheta": 0.25461721420288086,
      "pose_rmse_dx": 0.05796835198998451,
      "pose_rmse_dy": 0.09905537962913513,
      "pose_rmse_mean": 0.13721364736557007,
      "rmse_dtheta": 0.030408760532736778,
      "rmse_dx": 0.0053453766740858555,
      "rmse_dy": 0.006948960945010185,
      "rmse_mean": 0.014234366826713085,
      "rotation_flip": 0.010130857117474079,
      "sparse_tokens": 32089.0,
      "step": 2139,
      "turn_loss": 0.10521717369556427,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35578.0,
      "epoch": 0.09942389890354952,
      "grad_norm": 0.46470996737480164,
      "learning_rate": 9.3041139194239e-06,
      "loss": 0.13,
      "mae_dtheta": 0.026143701747059822,
      "mae_dx": 0.010349401272833347,
      "mae_dy": 0.003063586773350835,
      "pose_mae_dtheta": 0.2136816829442978,
      "pose_mae_dx": 0.08222214877605438,
      "pose_mae_dy": 0.044843047857284546,
      "pose_rmse_dtheta": 0.4201802909374237,
      "pose_rmse_dx": 0.19419358670711517,
      "pose_rmse_dy": 0.12832903861999512,
      "pose_rmse_mean": 0.24756763875484467,
      "rmse_dtheta": 0.0441177561879158,
      "rmse_dx": 0.022456903010606766,
      "rmse_dy": 0.006162719801068306,
      "rmse_mean": 0.024245794862508774,
      "rotation_flip": 0.013868613168597221,
      "sparse_tokens": 27131.0,
      "step": 2140,
      "turn_loss": 0.19587920606136322,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.0994703586693923,
      "grad_norm": 0.6639983057975769,
      "learning_rate": 9.303440885224153e-06,
      "loss": 0.1898,
      "mae_dtheta": 0.006521934177726507,
      "mae_dx": 0.001364034367725253,
      "mae_dy": 0.0004116141062695533,
      "pose_mae_dtheta": 0.046651821583509445,
      "pose_mae_dx": 0.011983983218669891,
      "pose_mae_dy": 0.0075115542858839035,
      "pose_rmse_dtheta": 0.2026263177394867,
      "pose_rmse_dx": 0.027239395305514336,
      "pose_rmse_dy": 0.023908475413918495,
      "pose_rmse_mean": 0.08459140360355377,
      "rmse_dtheta": 0.02539912797510624,
      "rmse_dx": 0.003951346501708031,
      "rmse_dy": 0.0009810893097892404,
      "rmse_mean": 0.01011052168905735,
      "rotation_flip": 0.0007072135922499001,
      "sparse_tokens": 32169.0,
      "step": 2141,
      "turn_loss": 0.04602431133389473,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.09951681843523509,
      "grad_norm": 0.622825562953949,
      "learning_rate": 9.302767550082474e-06,
      "loss": 0.2235,
      "mae_dtheta": 0.048132654279470444,
      "mae_dx": 0.015979398041963577,
      "mae_dy": 0.011504636146128178,
      "pose_mae_dtheta": 0.3604286015033722,
      "pose_mae_dx": 0.1178794875741005,
      "pose_mae_dy": 0.10210350155830383,
      "pose_rmse_dtheta": 0.5817158222198486,
      "pose_rmse_dx": 0.2271730899810791,
      "pose_rmse_dy": 0.22402161359786987,
      "pose_rmse_mean": 0.34430354833602905,
      "rmse_dtheta": 0.06442131847143173,
      "rmse_dx": 0.029750816524028778,
      "rmse_dy": 0.024022642523050308,
      "rmse_mean": 0.03939826041460037,
      "rotation_flip": 0.013280212879180908,
      "sparse_tokens": 12815.0,
      "step": 2142,
      "turn_loss": 0.5871482491493225,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.09956327820107787,
      "grad_norm": 0.49958086013793945,
      "learning_rate": 9.302093914045953e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.031213000416755676,
      "mae_dx": 0.01194580178707838,
      "mae_dy": 0.004320334177464247,
      "pose_mae_dtheta": 0.23990832269191742,
      "pose_mae_dx": 0.09512066841125488,
      "pose_mae_dy": 0.04788509011268616,
      "pose_rmse_dtheta": 0.42106273770332336,
      "pose_rmse_dx": 0.20201662182807922,
      "pose_rmse_dy": 0.10951825231313705,
      "pose_rmse_mean": 0.24419920146465302,
      "rmse_dtheta": 0.04717923700809479,
      "rmse_dx": 0.02361832931637764,
      "rmse_dy": 0.009225020185112953,
      "rmse_mean": 0.026674194261431694,
      "rotation_flip": 0.011282050982117653,
      "sparse_tokens": 14707.0,
      "step": 2143,
      "turn_loss": 0.27720123529434204,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.09960973796692064,
      "grad_norm": 0.7098102569580078,
      "learning_rate": 9.301419977161695e-06,
      "loss": 0.1586,
      "mae_dtheta": 0.015070375055074692,
      "mae_dx": 0.0049561383202672005,
      "mae_dy": 0.004162859171628952,
      "pose_mae_dtheta": 0.11249814182519913,
      "pose_mae_dx": 0.04724416136741638,
      "pose_mae_dy": 0.03630824014544487,
      "pose_rmse_dtheta": 0.27286508679389954,
      "pose_rmse_dx": 0.13638505339622498,
      "pose_rmse_dy": 0.09304267168045044,
      "pose_rmse_mean": 0.16743093729019165,
      "rmse_dtheta": 0.03146912530064583,
      "rmse_dx": 0.013402788899838924,
      "rmse_dy": 0.010490693151950836,
      "rmse_mean": 0.018454203382134438,
      "rotation_flip": 0.008313539437949657,
      "sparse_tokens": 32137.0,
      "step": 2144,
      "turn_loss": 0.14914698898792267,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.09965619773276342,
      "grad_norm": 0.6082218885421753,
      "learning_rate": 9.30074573947683e-06,
      "loss": 0.1797,
      "mae_dtheta": 0.036113191395998,
      "mae_dx": 0.013302388601005077,
      "mae_dy": 0.007400714326649904,
      "pose_mae_dtheta": 0.27720752358436584,
      "pose_mae_dx": 0.1061742752790451,
      "pose_mae_dy": 0.0692058727145195,
      "pose_rmse_dtheta": 0.476240336894989,
      "pose_rmse_dx": 0.22996266186237335,
      "pose_rmse_dy": 0.17212842404842377,
      "pose_rmse_mean": 0.2927771508693695,
      "rmse_dtheta": 0.05359247699379921,
      "rmse_dx": 0.025230711326003075,
      "rmse_dy": 0.015734460204839706,
      "rmse_mean": 0.03151921555399895,
      "rotation_flip": 0.006507592275738716,
      "sparse_tokens": 15167.0,
      "step": 2145,
      "turn_loss": 0.33209913969039917,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.09970265749860621,
      "grad_norm": 0.46781834959983826,
      "learning_rate": 9.300071201038503e-06,
      "loss": 0.1657,
      "mae_dtheta": 0.012767959386110306,
      "mae_dx": 0.003932409919798374,
      "mae_dy": 0.004148510284721851,
      "pose_mae_dtheta": 0.0960821658372879,
      "pose_mae_dx": 0.04078778252005577,
      "pose_mae_dy": 0.032863765954971313,
      "pose_rmse_dtheta": 0.22890543937683105,
      "pose_rmse_dx": 0.08999045193195343,
      "pose_rmse_dy": 0.07070820778608322,
      "pose_rmse_mean": 0.1298680305480957,
      "rmse_dtheta": 0.028185181319713593,
      "rmse_dx": 0.009688977152109146,
      "rmse_dy": 0.008957089856266975,
      "rmse_mean": 0.01561041735112667,
      "rotation_flip": 0.00472292210906744,
      "sparse_tokens": 32201.0,
      "step": 2146,
      "turn_loss": 0.15517069399356842,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.09974911726444899,
      "grad_norm": 0.5612230896949768,
      "learning_rate": 9.299396361893892e-06,
      "loss": 0.2016,
      "mae_dtheta": 0.036514561623334885,
      "mae_dx": 0.009274064563214779,
      "mae_dy": 0.005820234771817923,
      "pose_mae_dtheta": 0.2846738398075104,
      "pose_mae_dx": 0.07513848692178726,
      "pose_mae_dy": 0.06429648399353027,
      "pose_rmse_dtheta": 0.49109703302383423,
      "pose_rmse_dx": 0.16186796128749847,
      "pose_rmse_dy": 0.12434473633766174,
      "pose_rmse_mean": 0.25910326838493347,
      "rmse_dtheta": 0.05496708303689957,
      "rmse_dx": 0.019538000226020813,
      "rmse_dy": 0.01043184194713831,
      "rmse_mean": 0.028312308713793755,
      "rotation_flip": 0.015677491202950478,
      "sparse_tokens": 14584.0,
      "step": 2147,
      "turn_loss": 0.2924359440803528,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.09979557703029177,
      "grad_norm": 0.6300327777862549,
      "learning_rate": 9.298721222090186e-06,
      "loss": 0.107,
      "mae_dtheta": 0.011650176718831062,
      "mae_dx": 0.0024706865660846233,
      "mae_dy": 0.0011365254176780581,
      "pose_mae_dtheta": 0.08600363880395889,
      "pose_mae_dx": 0.023992832750082016,
      "pose_mae_dy": 0.015510981902480125,
      "pose_rmse_dtheta": 0.2838444113731384,
      "pose_rmse_dx": 0.07058756053447723,
      "pose_rmse_dy": 0.04755960777401924,
      "pose_rmse_mean": 0.13399720191955566,
      "rmse_dtheta": 0.03316468372941017,
      "rmse_dx": 0.007285469677299261,
      "rmse_dy": 0.003103103721514344,
      "rmse_mean": 0.014517752453684807,
      "rotation_flip": 0.007560483645647764,
      "sparse_tokens": 32201.0,
      "step": 2148,
      "turn_loss": 0.062111422419548035,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.09984203679613454,
      "grad_norm": 0.7027000784873962,
      "learning_rate": 9.298045781674595e-06,
      "loss": 0.135,
      "mae_dtheta": 0.007706086616963148,
      "mae_dx": 0.0037896898575127125,
      "mae_dy": 0.0018850459018722177,
      "pose_mae_dtheta": 0.05394657701253891,
      "pose_mae_dx": 0.03531627729535103,
      "pose_mae_dy": 0.026284052059054375,
      "pose_rmse_dtheta": 0.1394912749528885,
      "pose_rmse_dx": 0.09189730137586594,
      "pose_rmse_dy": 0.0745663270354271,
      "pose_rmse_mean": 0.10198497027158737,
      "rmse_dtheta": 0.020291481167078018,
      "rmse_dx": 0.011081413365900517,
      "rmse_dy": 0.005067936610430479,
      "rmse_mean": 0.012146944180130959,
      "rotation_flip": 0.003442340763285756,
      "sparse_tokens": 32121.0,
      "step": 2149,
      "turn_loss": 0.11789805442094803,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.09988849656197733,
      "grad_norm": 0.5425864458084106,
      "learning_rate": 9.29737004069436e-06,
      "loss": 0.0805,
      "mae_dtheta": 0.01143553201109171,
      "mae_dx": 0.0021439767442643642,
      "mae_dy": 0.0019112278241664171,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5425863862037659,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 154.43556213378906,
      "model/head/act_norm_mean": 117.62569049873737,
      "model/head/act_norm_min": 82.69713592529297,
      "model/head/act_over_embed": 80.83347573979692,
      "model/head/grad_frac": 0.06739580631256104,
      "model/head/grad_norm": 0.0365680456161499,
      "model/head/grad_zero_frac": 0.00012310144666116685,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6835592250631313,
      "model/head/update_ratio": 0.0006337980157695711,
      "model/head/weight_delta": 5.313190460205078,
      "model/head/weight_delta_rel": 0.09320909529924393,
      "model/head/weight_norm": 57.696685791015625,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41432955861091614,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41426522867127796,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41419467329978943,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2846869435550784,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12897028028964996,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06997751444578171,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.540938864628821,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002274539787322283,
      "model/modality_embedder.encoders.pose/weight_delta": 1.728399395942688,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05647219344973564,
      "model/modality_embedder.encoders.pose/weight_norm": 30.76556968688965,
      "model/modality_embedder/grad_frac": 0.12897028028964996,
      "model/modality_embedder/grad_norm": 0.06997751444578171,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.540938864628821,
      "model/modality_embedder/update_ratio": 0.002274539787322283,
      "model/modality_embedder/weight_delta": 1.728399395942688,
      "model/modality_embedder/weight_delta_rel": 0.05647219344973564,
      "model/modality_embedder/weight_norm": 30.76556968688965,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.80622100830078,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.158406986531986,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.0706205368042,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.60188345571443,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.054835010319948196,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02975272946059704,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010774811962619424,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.0667144060134888,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03887171670794487,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.613224029541016,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.24461364746094,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.224474406766074,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.15812873840332,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.33449496757973,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.058321643620729446,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03164453059434891,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010843753116205335,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.3315502405166626,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04612594097852707,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.182268142700195,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.78173065185547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.1814749679333,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.250309944152832,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.679364074941766,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06500612199306488,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03527143597602844,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011711057741194963,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.4206424951553345,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04770251363515854,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.118061065673828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.46155548095703,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.00300625300625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.268546104431152,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.93113742748847,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08405473083257675,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04560695216059685,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 8.069722389336675e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001545781153254211,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.2144386768341064,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.041503749787807465,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.504146575927734,
      "model/normalizer/grad_frac": 0.3531157970428467,
      "model/normalizer/grad_norm": 0.19159582257270813,
      "model/normalizer/grad_zero_frac": 0.00010635645594447851,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0024564675986766815,
      "model/normalizer/weight_delta": 2.5920400619506836,
      "model/normalizer/weight_delta_rel": 0.03338397666811943,
      "model/normalizer/weight_norm": 77.99647521972656,
      "pose_mae_dtheta": 0.08307144045829773,
      "pose_mae_dx": 0.025411248207092285,
      "pose_mae_dy": 0.030121177434921265,
      "pose_rmse_dtheta": 0.1770154982805252,
      "pose_rmse_dx": 0.05878053978085518,
      "pose_rmse_dy": 0.07616229355335236,
      "pose_rmse_mean": 0.10398610681295395,
      "rmse_dtheta": 0.024114711210131645,
      "rmse_dx": 0.0060254912823438644,
      "rmse_dy": 0.003943451214581728,
      "rmse_mean": 0.011361218057572842,
      "rotation_flip": 0.0024732069578021765,
      "sparse_tokens": 32153.0,
      "step": 2150,
      "turn_loss": 0.09381942451000214,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.09993495632782011,
      "grad_norm": 0.5670425295829773,
      "learning_rate": 9.296693999196729e-06,
      "loss": 0.1762,
      "mae_dtheta": 0.012069755233824253,
      "mae_dx": 0.0021823321003466845,
      "mae_dy": 0.002512225415557623,
      "pose_mae_dtheta": 0.08539781719446182,
      "pose_mae_dx": 0.021487653255462646,
      "pose_mae_dy": 0.039391953498125076,
      "pose_rmse_dtheta": 0.18966995179653168,
      "pose_rmse_dx": 0.06128271296620369,
      "pose_rmse_dy": 0.08844856172800064,
      "pose_rmse_mean": 0.1131337434053421,
      "rmse_dtheta": 0.02578163892030716,
      "rmse_dx": 0.007197038270533085,
      "rmse_dy": 0.005347110331058502,
      "rmse_mean": 0.01277526281774044,
      "rotation_flip": 0.007656967733055353,
      "sparse_tokens": 32089.0,
      "step": 2151,
      "turn_loss": 0.11238924413919449,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.09998141609366289,
      "grad_norm": 0.4844492971897125,
      "learning_rate": 9.296017657228981e-06,
      "loss": 0.1646,
      "mae_dtheta": 0.008700652047991753,
      "mae_dx": 0.002033235738053918,
      "mae_dy": 0.0018902947194874287,
      "pose_mae_dtheta": 0.05871978774666786,
      "pose_mae_dx": 0.01972622238099575,
      "pose_mae_dy": 0.023719673976302147,
      "pose_rmse_dtheta": 0.13040024042129517,
      "pose_rmse_dx": 0.04986506327986717,
      "pose_rmse_dy": 0.056082095950841904,
      "pose_rmse_mean": 0.07878246903419495,
      "rmse_dtheta": 0.01879771612584591,
      "rmse_dx": 0.00597640685737133,
      "rmse_dy": 0.0038504749536514282,
      "rmse_mean": 0.009541532956063747,
      "rotation_flip": 0.003045298857614398,
      "sparse_tokens": 32153.0,
      "step": 2152,
      "turn_loss": 0.070548415184021,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.10002787585950566,
      "grad_norm": 0.5393030643463135,
      "learning_rate": 9.295341014838412e-06,
      "loss": 0.0857,
      "mae_dtheta": 0.014803091995418072,
      "mae_dx": 0.002646492328494787,
      "mae_dy": 0.003979600500315428,
      "pose_mae_dtheta": 0.10937456041574478,
      "pose_mae_dx": 0.036671750247478485,
      "pose_mae_dy": 0.040942590683698654,
      "pose_rmse_dtheta": 0.2507059872150421,
      "pose_rmse_dx": 0.0936288833618164,
      "pose_rmse_dy": 0.09256771951913834,
      "pose_rmse_mean": 0.14563420414924622,
      "rmse_dtheta": 0.02893940545618534,
      "rmse_dx": 0.007024050690233707,
      "rmse_dy": 0.008614289574325085,
      "rmse_mean": 0.01485924981534481,
      "rotation_flip": 0.0046611689031124115,
      "sparse_tokens": 32137.0,
      "step": 2153,
      "turn_loss": 0.13534648716449738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.10007433562534845,
      "grad_norm": 0.8777697682380676,
      "learning_rate": 9.29466407207234e-06,
      "loss": 0.2657,
      "mae_dtheta": 0.05476389825344086,
      "mae_dx": 0.010266227647662163,
      "mae_dy": 0.007997150532901287,
      "pose_mae_dtheta": 0.4440739154815674,
      "pose_mae_dx": 0.09462007135152817,
      "pose_mae_dy": 0.09222175180912018,
      "pose_rmse_dtheta": 0.7020171284675598,
      "pose_rmse_dx": 0.22684817016124725,
      "pose_rmse_dy": 0.24274294078350067,
      "pose_rmse_mean": 0.3905360698699951,
      "rmse_dtheta": 0.07604092359542847,
      "rmse_dx": 0.020406542345881462,
      "rmse_dy": 0.017366450279951096,
      "rmse_mean": 0.03793797641992569,
      "rotation_flip": 0.010471204295754433,
      "sparse_tokens": 3329.0,
      "step": 2154,
      "turn_loss": 0.3312942087650299,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.10012079539119123,
      "grad_norm": 0.5381757616996765,
      "learning_rate": 9.293986828978106e-06,
      "loss": 0.1428,
      "mae_dtheta": 0.03749503567814827,
      "mae_dx": 0.014734228141605854,
      "mae_dy": 0.007425618823617697,
      "pose_mae_dtheta": 0.2968505918979645,
      "pose_mae_dx": 0.11261475086212158,
      "pose_mae_dy": 0.08894645422697067,
      "pose_rmse_dtheta": 0.4991261959075928,
      "pose_rmse_dx": 0.23403671383857727,
      "pose_rmse_dy": 0.18994560837745667,
      "pose_rmse_mean": 0.30770283937454224,
      "rmse_dtheta": 0.05623260885477066,
      "rmse_dx": 0.02751314453780651,
      "rmse_dy": 0.015778545290231705,
      "rmse_mean": 0.03317476809024811,
      "rotation_flip": 0.017835909500718117,
      "sparse_tokens": 13784.0,
      "step": 2155,
      "turn_loss": 0.3699474036693573,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.10016725515703401,
      "grad_norm": 0.446560263633728,
      "learning_rate": 9.293309285603066e-06,
      "loss": 0.1314,
      "mae_dtheta": 0.03515961021184921,
      "mae_dx": 0.014890005812048912,
      "mae_dy": 0.004014885053038597,
      "pose_mae_dtheta": 0.2824769914150238,
      "pose_mae_dx": 0.12696804106235504,
      "pose_mae_dy": 0.06363193690776825,
      "pose_rmse_dtheta": 0.4938277006149292,
      "pose_rmse_dx": 0.2716200053691864,
      "pose_rmse_dy": 0.15058057010173798,
      "pose_rmse_mean": 0.30534279346466064,
      "rmse_dtheta": 0.051728662103414536,
      "rmse_dx": 0.028679756447672844,
      "rmse_dy": 0.007369207683950663,
      "rmse_mean": 0.02925920858979225,
      "rotation_flip": 0.01115760114043951,
      "sparse_tokens": 22393.0,
      "step": 2156,
      "turn_loss": 0.2915098965167999,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 11021.0,
      "epoch": 0.10021371492287678,
      "grad_norm": 0.4831659197807312,
      "learning_rate": 9.292631441994605e-06,
      "loss": 0.1386,
      "mae_dtheta": 0.034519780427217484,
      "mae_dx": 0.013306421227753162,
      "mae_dy": 0.008710257709026337,
      "pose_mae_dtheta": 0.28200432658195496,
      "pose_mae_dx": 0.10939639806747437,
      "pose_mae_dy": 0.08284168690443039,
      "pose_rmse_dtheta": 0.5290060043334961,
      "pose_rmse_dx": 0.24068444967269897,
      "pose_rmse_dy": 0.1727202981710434,
      "pose_rmse_mean": 0.31413692235946655,
      "rmse_dtheta": 0.05406076833605766,
      "rmse_dx": 0.024482036009430885,
      "rmse_dy": 0.016807014122605324,
      "rmse_mean": 0.03178327530622482,
      "rotation_flip": 0.012500000186264515,
      "sparse_tokens": 9081.0,
      "step": 2157,
      "turn_loss": 0.33910006284713745,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10026017468871957,
      "grad_norm": 0.6348102688789368,
      "learning_rate": 9.291953298200122e-06,
      "loss": 0.0882,
      "mae_dtheta": 0.007981622591614723,
      "mae_dx": 0.0014619670109823346,
      "mae_dy": 0.001324186334386468,
      "pose_mae_dtheta": 0.0574987456202507,
      "pose_mae_dx": 0.015123331919312477,
      "pose_mae_dy": 0.020899664610624313,
      "pose_rmse_dtheta": 0.16065967082977295,
      "pose_rmse_dx": 0.0431094691157341,
      "pose_rmse_dy": 0.049920789897441864,
      "pose_rmse_mean": 0.08456331491470337,
      "rmse_dtheta": 0.020493950694799423,
      "rmse_dx": 0.004865931812673807,
      "rmse_dy": 0.0031903281342238188,
      "rmse_mean": 0.00951673649251461,
      "rotation_flip": 0.0027985074557363987,
      "sparse_tokens": 32121.0,
      "step": 2158,
      "turn_loss": 0.05378320440649986,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.10030663445456235,
      "grad_norm": 0.6972196698188782,
      "learning_rate": 9.291274854267043e-06,
      "loss": 0.1257,
      "mae_dtheta": 0.025336820632219315,
      "mae_dx": 0.008790208958089352,
      "mae_dy": 0.006588298827409744,
      "pose_mae_dtheta": 0.17082291841506958,
      "pose_mae_dx": 0.09697499126195908,
      "pose_mae_dy": 0.10405424982309341,
      "pose_rmse_dtheta": 0.28476569056510925,
      "pose_rmse_dx": 0.21337410807609558,
      "pose_rmse_dy": 0.19372886419296265,
      "pose_rmse_mean": 0.23062288761138916,
      "rmse_dtheta": 0.03862585127353668,
      "rmse_dx": 0.020300978794693947,
      "rmse_dy": 0.01097688265144825,
      "rmse_mean": 0.02330123633146286,
      "rotation_flip": 0.004819277208298445,
      "sparse_tokens": 7330.0,
      "step": 2159,
      "turn_loss": 0.23667974770069122,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10035309422040513,
      "grad_norm": 0.4802898168563843,
      "learning_rate": 9.290596110242808e-06,
      "loss": 0.1022,
      "mae_dtheta": 0.008104415610432625,
      "mae_dx": 0.0015421326970681548,
      "mae_dy": 0.0011989374179393053,
      "pose_mae_dtheta": 0.051953524351119995,
      "pose_mae_dx": 0.014385958202183247,
      "pose_mae_dy": 0.018259238451719284,
      "pose_rmse_dtheta": 0.15052396059036255,
      "pose_rmse_dx": 0.0414036363363266,
      "pose_rmse_dy": 0.048291366547346115,
      "pose_rmse_mean": 0.08007299154996872,
      "rmse_dtheta": 0.022007955238223076,
      "rmse_dx": 0.005608041770756245,
      "rmse_dy": 0.002696929732337594,
      "rmse_mean": 0.010104309767484665,
      "rotation_flip": 0.0037513398565351963,
      "sparse_tokens": 32105.0,
      "step": 2160,
      "turn_loss": 0.05811301991343498,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.1003995539862479,
      "grad_norm": 1.356300950050354,
      "learning_rate": 9.289917066174887e-06,
      "loss": 0.3181,
      "mae_dtheta": 0.03027225472033024,
      "mae_dx": 0.006736272014677525,
      "mae_dy": 0.005609492771327496,
      "pose_mae_dtheta": 0.20542371273040771,
      "pose_mae_dx": 0.054965823888778687,
      "pose_mae_dy": 0.08008668571710587,
      "pose_rmse_dtheta": 0.36669275164604187,
      "pose_rmse_dx": 0.13154305517673492,
      "pose_rmse_dy": 0.15105585753917694,
      "pose_rmse_mean": 0.21643057465553284,
      "rmse_dtheta": 0.04696044325828552,
      "rmse_dx": 0.016453860327601433,
      "rmse_dy": 0.010707378387451172,
      "rmse_mean": 0.02470722794532776,
      "rotation_flip": 0.024169184267520905,
      "sparse_tokens": 5430.0,
      "step": 2161,
      "turn_loss": 0.2570895552635193,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.1004460137520907,
      "grad_norm": 0.6897595524787903,
      "learning_rate": 9.28923772211076e-06,
      "loss": 0.1178,
      "mae_dtheta": 0.011209971271455288,
      "mae_dx": 0.0028987748082727194,
      "mae_dy": 0.0017802510410547256,
      "pose_mae_dtheta": 0.0788709968328476,
      "pose_mae_dx": 0.027858003973960876,
      "pose_mae_dy": 0.02133016474545002,
      "pose_rmse_dtheta": 0.211286261677742,
      "pose_rmse_dx": 0.05774466320872307,
      "pose_rmse_dy": 0.056170810014009476,
      "pose_rmse_mean": 0.10840058326721191,
      "rmse_dtheta": 0.026527926325798035,
      "rmse_dx": 0.007046240381896496,
      "rmse_dy": 0.004103825427591801,
      "rmse_mean": 0.012559331022202969,
      "rotation_flip": 0.006748709827661514,
      "sparse_tokens": 32233.0,
      "step": 2162,
      "turn_loss": 0.09143839031457901,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.10049247351793347,
      "grad_norm": 0.5669479370117188,
      "learning_rate": 9.288558078097938e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.03719114884734154,
      "mae_dx": 0.01120072416961193,
      "mae_dy": 0.006086014676839113,
      "pose_mae_dtheta": 0.30137884616851807,
      "pose_mae_dx": 0.08802937716245651,
      "pose_mae_dy": 0.07194824516773224,
      "pose_rmse_dtheta": 0.5230849981307983,
      "pose_rmse_dx": 0.18993371725082397,
      "pose_rmse_dy": 0.14615768194198608,
      "pose_rmse_mean": 0.2863921523094177,
      "rmse_dtheta": 0.05570730194449425,
      "rmse_dx": 0.02261493168771267,
      "rmse_dy": 0.011671488173305988,
      "rmse_mean": 0.02999790757894516,
      "rotation_flip": 0.008752735331654549,
      "sparse_tokens": 16042.0,
      "step": 2163,
      "turn_loss": 0.31244608759880066,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10053893328377625,
      "grad_norm": 0.7003580331802368,
      "learning_rate": 9.287878134183949e-06,
      "loss": 0.1814,
      "mae_dtheta": 0.0067986692301929,
      "mae_dx": 0.0032556699588894844,
      "mae_dy": 0.0012396943056955934,
      "pose_mae_dtheta": 0.05040888860821724,
      "pose_mae_dx": 0.030025498941540718,
      "pose_mae_dy": 0.01813211292028427,
      "pose_rmse_dtheta": 0.09716156125068665,
      "pose_rmse_dx": 0.09794069826602936,
      "pose_rmse_dy": 0.041624825447797775,
      "pose_rmse_mean": 0.07890903204679489,
      "rmse_dtheta": 0.013731740415096283,
      "rmse_dx": 0.010414284653961658,
      "rmse_dy": 0.002664926927536726,
      "rmse_mean": 0.008936984464526176,
      "rotation_flip": 0.001898433780297637,
      "sparse_tokens": 32121.0,
      "step": 2164,
      "turn_loss": 0.07745707780122757,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10058539304961903,
      "grad_norm": 0.6094714999198914,
      "learning_rate": 9.28719789041634e-06,
      "loss": 0.1864,
      "mae_dtheta": 0.011023813858628273,
      "mae_dx": 0.0016800963785499334,
      "mae_dy": 0.002107207430526614,
      "pose_mae_dtheta": 0.0812201201915741,
      "pose_mae_dx": 0.02104196324944496,
      "pose_mae_dy": 0.031200546771287918,
      "pose_rmse_dtheta": 0.19752809405326843,
      "pose_rmse_dx": 0.05142578110098839,
      "pose_rmse_dy": 0.06994757056236267,
      "pose_rmse_mean": 0.106300488114357,
      "rmse_dtheta": 0.024913698434829712,
      "rmse_dx": 0.005663279443979263,
      "rmse_dy": 0.005201900843530893,
      "rmse_mean": 0.01192629337310791,
      "rotation_flip": 0.005995717365294695,
      "sparse_tokens": 32089.0,
      "step": 2165,
      "turn_loss": 0.08430957794189453,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10063185281546182,
      "grad_norm": 0.6144787669181824,
      "learning_rate": 9.28651734684268e-06,
      "loss": 0.105,
      "mae_dtheta": 0.00988615769892931,
      "mae_dx": 0.0021129297092556953,
      "mae_dy": 0.002411176450550556,
      "pose_mae_dtheta": 0.07176676392555237,
      "pose_mae_dx": 0.025277642533183098,
      "pose_mae_dy": 0.025031855329871178,
      "pose_rmse_dtheta": 0.18279486894607544,
      "pose_rmse_dx": 0.056147005409002304,
      "pose_rmse_dy": 0.05824965238571167,
      "pose_rmse_mean": 0.09906384348869324,
      "rmse_dtheta": 0.022281328216195107,
      "rmse_dx": 0.006501520983874798,
      "rmse_dy": 0.00701066805049777,
      "rmse_mean": 0.01193117257207632,
      "rotation_flip": 0.0036630036775022745,
      "sparse_tokens": 32105.0,
      "step": 2166,
      "turn_loss": 0.09920758754014969,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1006783125813046,
      "grad_norm": 0.5428153276443481,
      "learning_rate": 9.285836503510562e-06,
      "loss": 0.1251,
      "mae_dtheta": 0.011327700689435005,
      "mae_dx": 0.0019257421372458339,
      "mae_dy": 0.002375077921897173,
      "pose_mae_dtheta": 0.07981164008378983,
      "pose_mae_dx": 0.026002753525972366,
      "pose_mae_dy": 0.03118697740137577,
      "pose_rmse_dtheta": 0.18998423218727112,
      "pose_rmse_dx": 0.07157748937606812,
      "pose_rmse_dy": 0.07006361335515976,
      "pose_rmse_mean": 0.11054178327322006,
      "rmse_dtheta": 0.025210171937942505,
      "rmse_dx": 0.005916311871260405,
      "rmse_dy": 0.005193347577005625,
      "rmse_mean": 0.012106611393392086,
      "rotation_flip": 0.005200945772230625,
      "sparse_tokens": 32073.0,
      "step": 2167,
      "turn_loss": 0.09352529793977737,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.10072477234714737,
      "grad_norm": 0.47511354088783264,
      "learning_rate": 9.285155360467597e-06,
      "loss": 0.1208,
      "mae_dtheta": 0.012268210761249065,
      "mae_dx": 0.0028304588049650192,
      "mae_dy": 0.002621960360556841,
      "pose_mae_dtheta": 0.08917518705129623,
      "pose_mae_dx": 0.031562745571136475,
      "pose_mae_dy": 0.03254648298025131,
      "pose_rmse_dtheta": 0.2124107927083969,
      "pose_rmse_dx": 0.07865665853023529,
      "pose_rmse_dy": 0.07190695405006409,
      "pose_rmse_mean": 0.12099146842956543,
      "rmse_dtheta": 0.025800436735153198,
      "rmse_dx": 0.007845639251172543,
      "rmse_dy": 0.005306742154061794,
      "rmse_mean": 0.012984273955225945,
      "rotation_flip": 0.006095496006309986,
      "sparse_tokens": 32185.0,
      "step": 2168,
      "turn_loss": 0.10220737755298615,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.10077123211299015,
      "grad_norm": 0.4012529253959656,
      "learning_rate": 9.284473917761418e-06,
      "loss": 0.073,
      "mae_dtheta": 0.009114428423345089,
      "mae_dx": 0.002400534227490425,
      "mae_dy": 0.002376912860199809,
      "pose_mae_dtheta": 0.06892743706703186,
      "pose_mae_dx": 0.025216013193130493,
      "pose_mae_dy": 0.031226051971316338,
      "pose_rmse_dtheta": 0.15936201810836792,
      "pose_rmse_dx": 0.08306998014450073,
      "pose_rmse_dy": 0.08809517323970795,
      "pose_rmse_mean": 0.1101757287979126,
      "rmse_dtheta": 0.020065104588866234,
      "rmse_dx": 0.008937971666455269,
      "rmse_dy": 0.007092032581567764,
      "rmse_mean": 0.012031703256070614,
      "rotation_flip": 0.0031796502880752087,
      "sparse_tokens": 32057.0,
      "step": 2169,
      "turn_loss": 0.08085845410823822,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10081769187883292,
      "grad_norm": 0.5899507999420166,
      "learning_rate": 9.283792175439679e-06,
      "loss": 0.1361,
      "mae_dtheta": 0.011530847288668156,
      "mae_dx": 0.002124353079125285,
      "mae_dy": 0.0029534592758864164,
      "pose_mae_dtheta": 0.0794566199183464,
      "pose_mae_dx": 0.03515046089887619,
      "pose_mae_dy": 0.03884493187069893,
      "pose_rmse_dtheta": 0.15827591717243195,
      "pose_rmse_dx": 0.08363533765077591,
      "pose_rmse_dy": 0.09059350937604904,
      "pose_rmse_mean": 0.11083492636680603,
      "rmse_dtheta": 0.02181631326675415,
      "rmse_dx": 0.006400019861757755,
      "rmse_dy": 0.006348892580717802,
      "rmse_mean": 0.01152174174785614,
      "rotation_flip": 0.0026345502119511366,
      "sparse_tokens": 32089.0,
      "step": 2170,
      "turn_loss": 0.08895203471183777,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11057.0,
      "epoch": 0.10086415164467571,
      "grad_norm": 0.6590666770935059,
      "learning_rate": 9.283110133550053e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.031109243631362915,
      "mae_dx": 0.008602822199463844,
      "mae_dy": 0.0031816349364817142,
      "pose_mae_dtheta": 0.2577686905860901,
      "pose_mae_dx": 0.07160679996013641,
      "pose_mae_dy": 0.04067695140838623,
      "pose_rmse_dtheta": 0.4524978697299957,
      "pose_rmse_dx": 0.1639423370361328,
      "pose_rmse_dy": 0.0938330814242363,
      "pose_rmse_mean": 0.23675775527954102,
      "rmse_dtheta": 0.04811502993106842,
      "rmse_dx": 0.01881426014006138,
      "rmse_dy": 0.005637912545353174,
      "rmse_mean": 0.024189068004488945,
      "rotation_flip": 0.024029575288295746,
      "sparse_tokens": 8523.0,
      "step": 2171,
      "turn_loss": 0.23952366411685944,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10091061141051849,
      "grad_norm": 0.5105772018432617,
      "learning_rate": 9.282427792140237e-06,
      "loss": 0.0914,
      "mae_dtheta": 0.014032850973308086,
      "mae_dx": 0.0030522840097546577,
      "mae_dy": 0.005185538902878761,
      "pose_mae_dtheta": 0.09800147265195847,
      "pose_mae_dx": 0.048909906297922134,
      "pose_mae_dy": 0.04984923452138901,
      "pose_rmse_dtheta": 0.1802251785993576,
      "pose_rmse_dx": 0.12458030879497528,
      "pose_rmse_dy": 0.10309604555368423,
      "pose_rmse_mean": 0.1359671801328659,
      "rmse_dtheta": 0.023731723427772522,
      "rmse_dx": 0.007331908214837313,
      "rmse_dy": 0.010767973028123379,
      "rmse_mean": 0.013943868689239025,
      "rotation_flip": 0.004082914441823959,
      "sparse_tokens": 32121.0,
      "step": 2172,
      "turn_loss": 0.13713252544403076,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.10095707117636127,
      "grad_norm": 0.6035043597221375,
      "learning_rate": 9.281745151257946e-06,
      "loss": 0.1482,
      "mae_dtheta": 0.031171802431344986,
      "mae_dx": 0.012400154024362564,
      "mae_dy": 0.004147503525018692,
      "pose_mae_dtheta": 0.22649648785591125,
      "pose_mae_dx": 0.09025033563375473,
      "pose_mae_dy": 0.04023008048534393,
      "pose_rmse_dtheta": 0.38618114590644836,
      "pose_rmse_dx": 0.1911148875951767,
      "pose_rmse_dy": 0.0982605516910553,
      "pose_rmse_mean": 0.22518551349639893,
      "rmse_dtheta": 0.047518450766801834,
      "rmse_dx": 0.024027330800890923,
      "rmse_dy": 0.008171461522579193,
      "rmse_mean": 0.026572413742542267,
      "rotation_flip": 0.014332965947687626,
      "sparse_tokens": 15495.0,
      "step": 2173,
      "turn_loss": 0.26502177119255066,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.10100353094220405,
      "grad_norm": 0.4911547601222992,
      "learning_rate": 9.281062210950919e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.03732418268918991,
      "mae_dx": 0.0019031590782105923,
      "mae_dy": 0.0047996011562645435,
      "pose_mae_dtheta": 0.29111236333847046,
      "pose_mae_dx": 0.024643169716000557,
      "pose_mae_dy": 0.04815634340047836,
      "pose_rmse_dtheta": 0.5430722832679749,
      "pose_rmse_dx": 0.05942599102854729,
      "pose_rmse_dy": 0.11177501827478409,
      "pose_rmse_mean": 0.2380911111831665,
      "rmse_dtheta": 0.055427782237529755,
      "rmse_dx": 0.004664123523980379,
      "rmse_dy": 0.00952799804508686,
      "rmse_mean": 0.02320663444697857,
      "rotation_flip": 0.005154639016836882,
      "sparse_tokens": 3157.0,
      "step": 2174,
      "turn_loss": 0.18123096227645874,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10104999070804684,
      "grad_norm": 0.5493752956390381,
      "learning_rate": 9.280378971266914e-06,
      "loss": 0.1394,
      "mae_dtheta": 0.012580562382936478,
      "mae_dx": 0.0019665369763970375,
      "mae_dy": 0.003324872348457575,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5493754148483276,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.56842041015625,
      "model/head/act_norm_mean": 105.9684935290404,
      "model/head/act_norm_min": 72.31326293945312,
      "model/head/act_over_embed": 72.82254084582365,
      "model/head/grad_frac": 0.11053509265184402,
      "model/head/grad_norm": 0.06072526425123215,
      "model/head/grad_zero_frac": 0.00016847130609676242,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6878008601641414,
      "model/head/update_ratio": 0.0010523656383156776,
      "model/head/weight_delta": 5.3445539474487305,
      "model/head/weight_delta_rel": 0.09375930577516556,
      "model/head/weight_norm": 57.70357894897461,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41454556584358215,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41446466830813833,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41439345479011536,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28482400034071215,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08772359788417816,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04819318652153015,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5417162976457399,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001566397026181221,
      "model/modality_embedder.encoders.pose/weight_delta": 1.731100082397461,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05656043440103531,
      "model/modality_embedder.encoders.pose/weight_norm": 30.766904830932617,
      "model/modality_embedder/grad_frac": 0.08772359788417816,
      "model/modality_embedder/grad_norm": 0.04819318652153015,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5417162976457399,
      "model/modality_embedder/update_ratio": 0.001566397026181221,
      "model/modality_embedder/weight_delta": 1.731100082397461,
      "model/modality_embedder/weight_delta_rel": 0.05656043440103531,
      "model/modality_embedder/weight_norm": 30.766904830932617,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.7079086303711,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.092685285393618,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.968979835510254,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.869509525248377,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08513037115335464,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04676853120326996,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016936358297243714,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.0762674808502197,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.03921983763575554,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.61427879333496,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.47005462646484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.15440867003367,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.408455848693848,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.599135775183957,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09286568313837051,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0510181225836277,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001748089212924242,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.3456803560256958,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.046615418046712875,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.18507957458496,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.6011734008789,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.129787457912457,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.526619911193848,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.956634572001846,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11136747896671295,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06118255481123924,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0020312012638896704,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.4357305765151978,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04820914566516876,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.12136459350586,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.65953063964844,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.05244909411576,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.331040382385254,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.27790564864259,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.13488292694091797,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07410136610269547,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0025113660376518965,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.2264151573181152,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.041913051158189774,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.506399154663086,
      "model/normalizer/grad_frac": 0.5544498562812805,
      "model/normalizer/grad_norm": 0.30460113286972046,
      "model/normalizer/grad_zero_frac": 0.00014653555990662426,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0039051591884344816,
      "model/normalizer/weight_delta": 2.6181278228759766,
      "model/normalizer/weight_delta_rel": 0.033719971776008606,
      "model/normalizer/weight_norm": 77.99967193603516,
      "pose_mae_dtheta": 0.08145304769277573,
      "pose_mae_dx": 0.030116839334368706,
      "pose_mae_dy": 0.03961121290922165,
      "pose_rmse_dtheta": 0.15118500590324402,
      "pose_rmse_dx": 0.06242302432656288,
      "pose_rmse_dy": 0.07863230258226395,
      "pose_rmse_mean": 0.09741344302892685,
      "rmse_dtheta": 0.022186459973454475,
      "rmse_dx": 0.005001415498554707,
      "rmse_dy": 0.006129927933216095,
      "rmse_mean": 0.011105935089290142,
      "rotation_flip": 0.006439149845391512,
      "sparse_tokens": 32105.0,
      "step": 2175,
      "turn_loss": 0.10940928757190704,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10109645047388961,
      "grad_norm": 0.2858295738697052,
      "learning_rate": 9.27969543225371e-06,
      "loss": 0.0836,
      "mae_dtheta": 0.00797023344784975,
      "mae_dx": 0.0016828634543344378,
      "mae_dy": 0.0003133818681817502,
      "pose_mae_dtheta": 0.05661816522479057,
      "pose_mae_dx": 0.013845343142747879,
      "pose_mae_dy": 0.004338668659329414,
      "pose_rmse_dtheta": 0.248503178358078,
      "pose_rmse_dx": 0.04360508918762207,
      "pose_rmse_dy": 0.008863640949130058,
      "pose_rmse_mean": 0.10032396763563156,
      "rmse_dtheta": 0.03019527532160282,
      "rmse_dx": 0.005552067421376705,
      "rmse_dy": 0.0005960799753665924,
      "rmse_mean": 0.012114474549889565,
      "rotation_flip": 0.002926829271018505,
      "sparse_tokens": 32121.0,
      "step": 2176,
      "turn_loss": 0.03828655928373337,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36988.0,
      "epoch": 0.10114291023973239,
      "grad_norm": 0.5741320848464966,
      "learning_rate": 9.279011593959107e-06,
      "loss": 0.2195,
      "mae_dtheta": 0.035546429455280304,
      "mae_dx": 0.01434545312076807,
      "mae_dy": 0.004601255524903536,
      "pose_mae_dtheta": 0.27335482835769653,
      "pose_mae_dx": 0.10927286744117737,
      "pose_mae_dy": 0.049344420433044434,
      "pose_rmse_dtheta": 0.4988526403903961,
      "pose_rmse_dx": 0.24374890327453613,
      "pose_rmse_dy": 0.10669132322072983,
      "pose_rmse_mean": 0.28309762477874756,
      "rmse_dtheta": 0.05377662181854248,
      "rmse_dx": 0.027375906705856323,
      "rmse_dy": 0.010233394801616669,
      "rmse_mean": 0.030461974442005157,
      "rotation_flip": 0.014678899198770523,
      "sparse_tokens": 27356.0,
      "step": 2177,
      "turn_loss": 0.26121196150779724,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.10118937000557517,
      "grad_norm": 0.5793604850769043,
      "learning_rate": 9.278327456430927e-06,
      "loss": 0.1386,
      "mae_dtheta": 0.029272209852933884,
      "mae_dx": 0.010698629543185234,
      "mae_dy": 0.004663120023906231,
      "pose_mae_dtheta": 0.21896813809871674,
      "pose_mae_dx": 0.09757743030786514,
      "pose_mae_dy": 0.0441075935959816,
      "pose_rmse_dtheta": 0.3672633767127991,
      "pose_rmse_dx": 0.22064237296581268,
      "pose_rmse_dy": 0.08223938196897507,
      "pose_rmse_mean": 0.22338172793388367,
      "rmse_dtheta": 0.04319622740149498,
      "rmse_dx": 0.02303430438041687,
      "rmse_dy": 0.009033242240548134,
      "rmse_mean": 0.025087926536798477,
      "rotation_flip": 0.010101010091602802,
      "sparse_tokens": 8701.0,
      "step": 2178,
      "turn_loss": 0.2591242492198944,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.10123582977141796,
      "grad_norm": 0.628555178642273,
      "learning_rate": 9.277643019717011e-06,
      "loss": 0.1897,
      "mae_dtheta": 0.036382775753736496,
      "mae_dx": 0.008177247829735279,
      "mae_dy": 0.003574293339625001,
      "pose_mae_dtheta": 0.30186697840690613,
      "pose_mae_dx": 0.05730527266860008,
      "pose_mae_dy": 0.04248948022723198,
      "pose_rmse_dtheta": 0.5700502991676331,
      "pose_rmse_dx": 0.131828173995018,
      "pose_rmse_dy": 0.10089559108018875,
      "pose_rmse_mean": 0.26759135723114014,
      "rmse_dtheta": 0.05767880752682686,
      "rmse_dx": 0.018947813659906387,
      "rmse_dy": 0.007258052006363869,
      "rmse_mean": 0.02796155773103237,
      "rotation_flip": 0.0060606058686971664,
      "sparse_tokens": 11127.0,
      "step": 2179,
      "turn_loss": 0.20839227735996246,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 33738.0,
      "epoch": 0.10128228953726073,
      "grad_norm": 0.4335004985332489,
      "learning_rate": 9.276958283865223e-06,
      "loss": 0.125,
      "mae_dtheta": 0.03358317166566849,
      "mae_dx": 0.010771749541163445,
      "mae_dy": 0.005098364781588316,
      "pose_mae_dtheta": 0.24709361791610718,
      "pose_mae_dx": 0.09205890446901321,
      "pose_mae_dy": 0.05840539187192917,
      "pose_rmse_dtheta": 0.4514017701148987,
      "pose_rmse_dx": 0.2130226045846939,
      "pose_rmse_dy": 0.1493222862482071,
      "pose_rmse_mean": 0.27124887704849243,
      "rmse_dtheta": 0.052166059613227844,
      "rmse_dx": 0.02269943803548813,
      "rmse_dy": 0.010785561054944992,
      "rmse_mean": 0.02855035290122032,
      "rotation_flip": 0.012145749293267727,
      "sparse_tokens": 27078.0,
      "step": 2180,
      "turn_loss": 0.24165502190589905,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.10132874930310351,
      "grad_norm": 0.6946933269500732,
      "learning_rate": 9.276273248923446e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.010221353732049465,
      "mae_dx": 0.0028867567889392376,
      "mae_dy": 0.004364856518805027,
      "pose_mae_dtheta": 0.07045924663543701,
      "pose_mae_dx": 0.04307865723967552,
      "pose_mae_dy": 0.03620396554470062,
      "pose_rmse_dtheta": 0.17124511301517487,
      "pose_rmse_dx": 0.11581838130950928,
      "pose_rmse_dy": 0.10152877867221832,
      "pose_rmse_mean": 0.12953075766563416,
      "rmse_dtheta": 0.0214553065598011,
      "rmse_dx": 0.007291118614375591,
      "rmse_dy": 0.010273114778101444,
      "rmse_mean": 0.013006513938307762,
      "rotation_flip": 0.004258614033460617,
      "sparse_tokens": 32057.0,
      "step": 2181,
      "turn_loss": 0.10007729381322861,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10137520906894629,
      "grad_norm": 0.574583888053894,
      "learning_rate": 9.275587914939586e-06,
      "loss": 0.1336,
      "mae_dtheta": 0.016804762184619904,
      "mae_dx": 0.0023463305551558733,
      "mae_dy": 0.0031260293908417225,
      "pose_mae_dtheta": 0.11621083319187164,
      "pose_mae_dx": 0.03200368583202362,
      "pose_mae_dy": 0.03841545060276985,
      "pose_rmse_dtheta": 0.31385016441345215,
      "pose_rmse_dx": 0.07447031140327454,
      "pose_rmse_dy": 0.08663975447416306,
      "pose_rmse_mean": 0.1583200842142105,
      "rmse_dtheta": 0.03628169000148773,
      "rmse_dx": 0.005932281259447336,
      "rmse_dy": 0.006398284807801247,
      "rmse_mean": 0.01620408706367016,
      "rotation_flip": 0.004649360664188862,
      "sparse_tokens": 32089.0,
      "step": 2182,
      "turn_loss": 0.15038804709911346,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22719.0,
      "epoch": 0.10142166883478908,
      "grad_norm": 0.740105926990509,
      "learning_rate": 9.274902281961568e-06,
      "loss": 0.1949,
      "mae_dtheta": 0.0279746875166893,
      "mae_dx": 0.012832527048885822,
      "mae_dy": 0.006513087544590235,
      "pose_mae_dtheta": 0.22406405210494995,
      "pose_mae_dx": 0.09808410704135895,
      "pose_mae_dy": 0.0644826740026474,
      "pose_rmse_dtheta": 0.41763848066329956,
      "pose_rmse_dx": 0.24653993546962738,
      "pose_rmse_dy": 0.1446894109249115,
      "pose_rmse_mean": 0.2696226239204407,
      "rmse_dtheta": 0.044808387756347656,
      "rmse_dx": 0.026515066623687744,
      "rmse_dy": 0.013363814912736416,
      "rmse_mean": 0.028229091316461563,
      "rotation_flip": 0.010683760978281498,
      "sparse_tokens": 18875.0,
      "step": 2183,
      "turn_loss": 0.27243897318840027,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.10146812860063185,
      "grad_norm": 0.9525446891784668,
      "learning_rate": 9.27421635003734e-06,
      "loss": 0.2357,
      "mae_dtheta": 0.029381174594163895,
      "mae_dx": 0.009796940721571445,
      "mae_dy": 0.0064715133048594,
      "pose_mae_dtheta": 0.24656175076961517,
      "pose_mae_dx": 0.0694517269730568,
      "pose_mae_dy": 0.05207003653049469,
      "pose_rmse_dtheta": 0.5046308040618896,
      "pose_rmse_dx": 0.2396417111158371,
      "pose_rmse_dy": 0.12322207540273666,
      "pose_rmse_mean": 0.28916487097740173,
      "rmse_dtheta": 0.05089369788765907,
      "rmse_dx": 0.02357977256178856,
      "rmse_dy": 0.014925765804946423,
      "rmse_mean": 0.029799744486808777,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 10092.0,
      "step": 2184,
      "turn_loss": 0.24690169095993042,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.10151458836647463,
      "grad_norm": 0.4088134467601776,
      "learning_rate": 9.273530119214868e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.007292626891285181,
      "mae_dx": 0.0018319037044420838,
      "mae_dy": 0.0019151553278788924,
      "pose_mae_dtheta": 0.055519863963127136,
      "pose_mae_dx": 0.02042759396135807,
      "pose_mae_dy": 0.0221321452409029,
      "pose_rmse_dtheta": 0.16442440450191498,
      "pose_rmse_dx": 0.06791189312934875,
      "pose_rmse_dy": 0.061810240149497986,
      "pose_rmse_mean": 0.0980488508939743,
      "rmse_dtheta": 0.021321268752217293,
      "rmse_dx": 0.006601312663406134,
      "rmse_dy": 0.006541475187987089,
      "rmse_mean": 0.011488019488751888,
      "rotation_flip": 0.0053795576095581055,
      "sparse_tokens": 32057.0,
      "step": 2185,
      "turn_loss": 0.06755693256855011,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 48688.0,
      "epoch": 0.10156104813231741,
      "grad_norm": 0.4996841251850128,
      "learning_rate": 9.272843589542143e-06,
      "loss": 0.167,
      "mae_dtheta": 0.035930149257183075,
      "mae_dx": 0.010408025234937668,
      "mae_dy": 0.0040544248186051846,
      "pose_mae_dtheta": 0.27961477637290955,
      "pose_mae_dx": 0.07941874861717224,
      "pose_mae_dy": 0.03840358555316925,
      "pose_rmse_dtheta": 0.4674377739429474,
      "pose_rmse_dx": 0.19020013511180878,
      "pose_rmse_dy": 0.10493762046098709,
      "pose_rmse_mean": 0.2541918456554413,
      "rmse_dtheta": 0.05313190817832947,
      "rmse_dx": 0.02231219969689846,
      "rmse_dy": 0.009949502535164356,
      "rmse_mean": 0.028464538976550102,
      "rotation_flip": 0.01913265325129032,
      "sparse_tokens": 30688.0,
      "step": 2186,
      "turn_loss": 0.2738346755504608,
      "turns": 150.0,
      "turns_per_sample": 150.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.1016075078981602,
      "grad_norm": 0.6179484128952026,
      "learning_rate": 9.272156761067167e-06,
      "loss": 0.1488,
      "mae_dtheta": 0.03434523195028305,
      "mae_dx": 0.00733601301908493,
      "mae_dy": 0.0062271892093122005,
      "pose_mae_dtheta": 0.3051697015762329,
      "pose_mae_dx": 0.06184031441807747,
      "pose_mae_dy": 0.07753633707761765,
      "pose_rmse_dtheta": 0.4910315275192261,
      "pose_rmse_dx": 0.12656718492507935,
      "pose_rmse_dy": 0.16512823104858398,
      "pose_rmse_mean": 0.26090899109840393,
      "rmse_dtheta": 0.05069263279438019,
      "rmse_dx": 0.01658029668033123,
      "rmse_dy": 0.013154257088899612,
      "rmse_mean": 0.02680906280875206,
      "rotation_flip": 0.01138211414217949,
      "sparse_tokens": 10469.0,
      "step": 2187,
      "turn_loss": 0.31387463212013245,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.10165396766400298,
      "grad_norm": 0.8115962147712708,
      "learning_rate": 9.271469633837981e-06,
      "loss": 0.2774,
      "mae_dtheta": 0.034850701689720154,
      "mae_dx": 0.010873742401599884,
      "mae_dy": 0.0055468431673944,
      "pose_mae_dtheta": 0.30492180585861206,
      "pose_mae_dx": 0.08789385855197906,
      "pose_mae_dy": 0.07252639532089233,
      "pose_rmse_dtheta": 0.5246127843856812,
      "pose_rmse_dx": 0.18458513915538788,
      "pose_rmse_dy": 0.17458128929138184,
      "pose_rmse_mean": 0.29459309577941895,
      "rmse_dtheta": 0.054056230932474136,
      "rmse_dx": 0.02249620482325554,
      "rmse_dy": 0.010528757236897945,
      "rmse_mean": 0.029027065262198448,
      "rotation_flip": 0.00929368007928133,
      "sparse_tokens": 18250.0,
      "step": 2188,
      "turn_loss": 0.2879329323768616,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.10170042742984575,
      "grad_norm": 0.49786749482154846,
      "learning_rate": 9.27078220790263e-06,
      "loss": 0.1055,
      "mae_dtheta": 0.011433087289333344,
      "mae_dx": 0.003418160602450371,
      "mae_dy": 0.003278167685493827,
      "pose_mae_dtheta": 0.07613391429185867,
      "pose_mae_dx": 0.0310564823448658,
      "pose_mae_dy": 0.031034814193844795,
      "pose_rmse_dtheta": 0.17300142347812653,
      "pose_rmse_dx": 0.09378240257501602,
      "pose_rmse_dy": 0.07178708910942078,
      "pose_rmse_mean": 0.11285697668790817,
      "rmse_dtheta": 0.02442561648786068,
      "rmse_dx": 0.011224845424294472,
      "rmse_dy": 0.008329255506396294,
      "rmse_mean": 0.01465990673750639,
      "rotation_flip": 0.005401234608143568,
      "sparse_tokens": 32153.0,
      "step": 2189,
      "turn_loss": 0.11778033524751663,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.10174688719568853,
      "grad_norm": 0.481611967086792,
      "learning_rate": 9.270094483309185e-06,
      "loss": 0.123,
      "mae_dtheta": 0.04068964347243309,
      "mae_dx": 0.011616615578532219,
      "mae_dy": 0.003127972362563014,
      "pose_mae_dtheta": 0.32355818152427673,
      "pose_mae_dx": 0.09893061965703964,
      "pose_mae_dy": 0.03298468515276909,
      "pose_rmse_dtheta": 0.5647728443145752,
      "pose_rmse_dx": 0.2178114801645279,
      "pose_rmse_dy": 0.08964741230010986,
      "pose_rmse_mean": 0.2907439172267914,
      "rmse_dtheta": 0.05977923050522804,
      "rmse_dx": 0.022984055802226067,
      "rmse_dy": 0.007014816626906395,
      "rmse_mean": 0.029926035553216934,
      "rotation_flip": 0.012658228166401386,
      "sparse_tokens": 15535.0,
      "step": 2190,
      "turn_loss": 0.2976413369178772,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.10179334696153132,
      "grad_norm": 0.7003795504570007,
      "learning_rate": 9.269406460105742e-06,
      "loss": 0.0863,
      "mae_dtheta": 0.011304193176329136,
      "mae_dx": 0.0018469245405867696,
      "mae_dy": 0.0027044781018048525,
      "pose_mae_dtheta": 0.08186449855566025,
      "pose_mae_dx": 0.028207795694470406,
      "pose_mae_dy": 0.03979984670877457,
      "pose_rmse_dtheta": 0.15601038932800293,
      "pose_rmse_dx": 0.07343494892120361,
      "pose_rmse_dy": 0.08664872497320175,
      "pose_rmse_mean": 0.10536469519138336,
      "rmse_dtheta": 0.019601207226514816,
      "rmse_dx": 0.0057601723819971085,
      "rmse_dy": 0.005291234701871872,
      "rmse_mean": 0.010217538103461266,
      "rotation_flip": 0.0070474776439368725,
      "sparse_tokens": 32057.0,
      "step": 2191,
      "turn_loss": 0.08480957895517349,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1018398067273741,
      "grad_norm": 0.5505844354629517,
      "learning_rate": 9.268718138340413e-06,
      "loss": 0.1083,
      "mae_dtheta": 0.00585201708599925,
      "mae_dx": 0.0012852761428803205,
      "mae_dy": 0.0008566702017560601,
      "pose_mae_dtheta": 0.042280007153749466,
      "pose_mae_dx": 0.011185342445969582,
      "pose_mae_dy": 0.011730851605534554,
      "pose_rmse_dtheta": 0.16065192222595215,
      "pose_rmse_dx": 0.030939236283302307,
      "pose_rmse_dy": 0.03433425351977348,
      "pose_rmse_mean": 0.07530847191810608,
      "rmse_dtheta": 0.021085210144519806,
      "rmse_dx": 0.0047205290757119656,
      "rmse_dy": 0.0036942537408322096,
      "rmse_mean": 0.00983333121985197,
      "rotation_flip": 0.003738317871466279,
      "sparse_tokens": 32137.0,
      "step": 2192,
      "turn_loss": 0.04549246281385422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.10188626649321687,
      "grad_norm": 0.44106006622314453,
      "learning_rate": 9.268029518061335e-06,
      "loss": 0.1509,
      "mae_dtheta": 0.010846016928553581,
      "mae_dx": 0.0016835123533383012,
      "mae_dy": 0.0025882613845169544,
      "pose_mae_dtheta": 0.06718457490205765,
      "pose_mae_dx": 0.023128541186451912,
      "pose_mae_dy": 0.029126906767487526,
      "pose_rmse_dtheta": 0.13945432007312775,
      "pose_rmse_dx": 0.049744680523872375,
      "pose_rmse_dy": 0.0633702278137207,
      "pose_rmse_mean": 0.08418974280357361,
      "rmse_dtheta": 0.0218400526791811,
      "rmse_dx": 0.004194080829620361,
      "rmse_dy": 0.004799152258783579,
      "rmse_mean": 0.010277762077748775,
      "rotation_flip": 0.00280997552908957,
      "sparse_tokens": 32153.0,
      "step": 2193,
      "turn_loss": 0.09689445048570633,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10193272625905965,
      "grad_norm": 0.7307604551315308,
      "learning_rate": 9.267340599316659e-06,
      "loss": 0.1356,
      "mae_dtheta": 0.012811722233891487,
      "mae_dx": 0.0023415624164044857,
      "mae_dy": 0.0037666840944439173,
      "pose_mae_dtheta": 0.09211789816617966,
      "pose_mae_dx": 0.032001566141843796,
      "pose_mae_dy": 0.04693903028964996,
      "pose_rmse_dtheta": 0.17969943583011627,
      "pose_rmse_dx": 0.08327846229076385,
      "pose_rmse_dy": 0.11911928653717041,
      "pose_rmse_mean": 0.12736573815345764,
      "rmse_dtheta": 0.024235602468252182,
      "rmse_dx": 0.006989542860537767,
      "rmse_dy": 0.009927749633789062,
      "rmse_mean": 0.013717631809413433,
      "rotation_flip": 0.007997091859579086,
      "sparse_tokens": 32105.0,
      "step": 2194,
      "turn_loss": 0.12079610675573349,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10197918602490244,
      "grad_norm": 0.5704978108406067,
      "learning_rate": 9.266651382154567e-06,
      "loss": 0.193,
      "mae_dtheta": 0.017604414373636246,
      "mae_dx": 0.004661049693822861,
      "mae_dy": 0.006163880694657564,
      "pose_mae_dtheta": 0.12777924537658691,
      "pose_mae_dx": 0.05974152311682701,
      "pose_mae_dy": 0.05831918120384216,
      "pose_rmse_dtheta": 0.2757612466812134,
      "pose_rmse_dx": 0.14280849695205688,
      "pose_rmse_dy": 0.11978723108768463,
      "pose_rmse_mean": 0.1794523298740387,
      "rmse_dtheta": 0.03253407031297684,
      "rmse_dx": 0.011206721886992455,
      "rmse_dy": 0.01271782722324133,
      "rmse_mean": 0.018819540739059448,
      "rotation_flip": 0.0069974553771317005,
      "sparse_tokens": 32121.0,
      "step": 2195,
      "turn_loss": 0.17906919121742249,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.10202564579074522,
      "grad_norm": 0.4319884479045868,
      "learning_rate": 9.265961866623253e-06,
      "loss": 0.1453,
      "mae_dtheta": 0.014433705247938633,
      "mae_dx": 0.003190340008586645,
      "mae_dy": 0.00231435289606452,
      "pose_mae_dtheta": 0.10030809789896011,
      "pose_mae_dx": 0.03315536305308342,
      "pose_mae_dy": 0.032668836414813995,
      "pose_rmse_dtheta": 0.24339015781879425,
      "pose_rmse_dx": 0.07869421690702438,
      "pose_rmse_dy": 0.07608300447463989,
      "pose_rmse_mean": 0.13272246718406677,
      "rmse_dtheta": 0.03056645393371582,
      "rmse_dx": 0.008926184847950935,
      "rmse_dy": 0.004887713119387627,
      "rmse_mean": 0.014793450944125652,
      "rotation_flip": 0.005358614958822727,
      "sparse_tokens": 32137.0,
      "step": 2196,
      "turn_loss": 0.11247502267360687,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.102072105556588,
      "grad_norm": 0.6587637662887573,
      "learning_rate": 9.265272052770936e-06,
      "loss": 0.1814,
      "mae_dtheta": 0.03733137622475624,
      "mae_dx": 0.011067467741668224,
      "mae_dy": 0.005024708807468414,
      "pose_mae_dtheta": 0.3254735469818115,
      "pose_mae_dx": 0.08383603394031525,
      "pose_mae_dy": 0.06533733755350113,
      "pose_rmse_dtheta": 0.5734018087387085,
      "pose_rmse_dx": 0.1796923577785492,
      "pose_rmse_dy": 0.15970757603645325,
      "pose_rmse_mean": 0.3042672574520111,
      "rmse_dtheta": 0.056963007897138596,
      "rmse_dx": 0.022195549681782722,
      "rmse_dy": 0.008936222642660141,
      "rmse_mean": 0.029364928603172302,
      "rotation_flip": 0.008791209198534489,
      "sparse_tokens": 8157.0,
      "step": 2197,
      "turn_loss": 0.31672993302345276,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.10211856532243077,
      "grad_norm": 0.6951131224632263,
      "learning_rate": 9.264581940645855e-06,
      "loss": 0.1476,
      "mae_dtheta": 0.01467492152005434,
      "mae_dx": 0.0026435675099492073,
      "mae_dy": 0.004485344979912043,
      "pose_mae_dtheta": 0.09735967218875885,
      "pose_mae_dx": 0.038955479860305786,
      "pose_mae_dy": 0.048497799783945084,
      "pose_rmse_dtheta": 0.2107580602169037,
      "pose_rmse_dx": 0.09288819879293442,
      "pose_rmse_dy": 0.1201808899641037,
      "pose_rmse_mean": 0.14127573370933533,
      "rmse_dtheta": 0.027811601758003235,
      "rmse_dx": 0.007311986293643713,
      "rmse_dy": 0.009339983575046062,
      "rmse_mean": 0.014821190387010574,
      "rotation_flip": 0.008576328866183758,
      "sparse_tokens": 32057.0,
      "step": 2198,
      "turn_loss": 0.14415523409843445,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16888.0,
      "epoch": 0.10216502508827356,
      "grad_norm": 0.4402811825275421,
      "learning_rate": 9.26389153029627e-06,
      "loss": 0.1313,
      "mae_dtheta": 0.04068855568766594,
      "mae_dx": 0.018981531262397766,
      "mae_dy": 0.006572752259671688,
      "pose_mae_dtheta": 0.3043520152568817,
      "pose_mae_dx": 0.14634406566619873,
      "pose_mae_dy": 0.09195344895124435,
      "pose_rmse_dtheta": 0.5127689242362976,
      "pose_rmse_dx": 0.2857314348220825,
      "pose_rmse_dy": 0.1933191567659378,
      "pose_rmse_mean": 0.33060652017593384,
      "rmse_dtheta": 0.05842969939112663,
      "rmse_dx": 0.03278643637895584,
      "rmse_dy": 0.011125092394649982,
      "rmse_mean": 0.03411374241113663,
      "rotation_flip": 0.015776699408888817,
      "sparse_tokens": 13890.0,
      "step": 2199,
      "turn_loss": 0.2574724853038788,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10221148485411634,
      "grad_norm": 0.5373976230621338,
      "learning_rate": 9.263200821770462e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.009550255723297596,
      "mae_dx": 0.001812698901630938,
      "mae_dy": 0.002621008548885584,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5373974442481995,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.50872802734375,
      "model/head/act_norm_mean": 115.20896464646465,
      "model/head/act_norm_min": 63.12654495239258,
      "model/head/act_over_embed": 79.1726791083712,
      "model/head/grad_frac": 0.10127430409193039,
      "model/head/grad_norm": 0.054424550384283066,
      "model/head/grad_zero_frac": 0.00017037494399119169,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6844371448863636,
      "model/head/update_ratio": 0.0009430486825294793,
      "model/head/weight_delta": 5.3791046142578125,
      "model/head/weight_delta_rel": 0.0943654254078865,
      "model/head/weight_norm": 57.71128463745117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41448909044265747,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41439565022786456,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4143248498439789,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2847765704697906,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11930157989263535,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06411236524581909,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5446701388888889,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002083724597468972,
      "model/modality_embedder.encoders.pose/weight_delta": 1.7456560134887695,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05703602358698845,
      "model/modality_embedder.encoders.pose/weight_norm": 30.768156051635742,
      "model/modality_embedder/grad_frac": 0.11930157989263535,
      "model/modality_embedder/grad_norm": 0.06411236524581909,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5446701388888889,
      "model/modality_embedder/update_ratio": 0.002083724597468972,
      "model/modality_embedder/weight_delta": 1.7456560134887695,
      "model/modality_embedder/weight_delta_rel": 0.05703602358698845,
      "model/modality_embedder/weight_norm": 30.768156051635742,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.26519012451172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.007748617123617,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.942712783813477,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.49834961377112,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07354782521724701,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03952441364526749,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014311257982626557,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.0876492261886597,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.039634592831134796,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.617708206176758,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.70235443115234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.091317440275773,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.331233978271484,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.242988253572435,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08346879482269287,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04485591873526573,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015367245068773627,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.3597440719604492,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04710259661078453,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.18930435180664,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.74299621582031,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.111431778098446,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.496610641479492,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.63122973913258,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09025177359580994,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04850107058882713,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001609942177310586,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.4506282806396484,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.048709381371736526,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.1259708404541,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.62223815917969,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.983448071989738,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.453630447387695,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.917696862387345,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09758853167295456,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05244382843375206,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017771899001672864,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.2392562627792358,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.042351897805929184,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.509410858154297,
      "model/normalizer/grad_frac": 0.3628004491329193,
      "model/normalizer/grad_norm": 0.19496802985668182,
      "model/normalizer/grad_zero_frac": 0.00015008078480605036,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0024994448758661747,
      "model/normalizer/weight_delta": 2.6455090045928955,
      "model/normalizer/weight_delta_rel": 0.034072622656822205,
      "model/normalizer/weight_norm": 78.00453186035156,
      "pose_mae_dtheta": 0.06118078902363777,
      "pose_mae_dx": 0.02517750672996044,
      "pose_mae_dy": 0.029732398688793182,
      "pose_rmse_dtheta": 0.11332923918962479,
      "pose_rmse_dx": 0.057160526514053345,
      "pose_rmse_dy": 0.06382540613412857,
      "pose_rmse_mean": 0.07810505479574203,
      "rmse_dtheta": 0.01818821020424366,
      "rmse_dx": 0.004946482367813587,
      "rmse_dy": 0.005376049317419529,
      "rmse_mean": 0.009503580629825592,
      "rotation_flip": 0.0034602077212184668,
      "sparse_tokens": 32121.0,
      "step": 2200,
      "turn_loss": 0.07698158919811249,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.10221148485411634,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3191312253475189,
      "eval_objectnav_nopose_mae_dtheta": 0.041161730885505676,
      "eval_objectnav_nopose_mae_dx": 0.013845651410520077,
      "eval_objectnav_nopose_mae_dy": 0.0047957100905478,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.33326929807662964,
      "eval_objectnav_nopose_pose_mae_dx": 0.11257090419530869,
      "eval_objectnav_nopose_pose_mae_dy": 0.05443476140499115,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5518482327461243,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24449221789836884,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1290687769651413,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3084697723388672,
      "eval_objectnav_nopose_rmse_dtheta": 0.058661915361881256,
      "eval_objectnav_nopose_rmse_dx": 0.026660539209842682,
      "eval_objectnav_nopose_rmse_dy": 0.009853367693722248,
      "eval_objectnav_nopose_rmse_mean": 0.03172527626156807,
      "eval_objectnav_nopose_rotation_flip": 0.015218555927276611,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3191312253475189,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 2200
    },
    {
      "epoch": 0.10221148485411634,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2912047803401947,
      "eval_objectnav_pose_mae_dtheta": 0.03770525008440018,
      "eval_objectnav_pose_mae_dx": 0.011792866513133049,
      "eval_objectnav_pose_mae_dy": 0.004634219687432051,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2936806082725525,
      "eval_objectnav_pose_pose_mae_dx": 0.09461215138435364,
      "eval_objectnav_pose_pose_mae_dy": 0.05107872188091278,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5126261115074158,
      "eval_objectnav_pose_pose_rmse_dx": 0.21710354089736938,
      "eval_objectnav_pose_pose_rmse_dy": 0.12043783813714981,
      "eval_objectnav_pose_pose_rmse_mean": 0.2833891808986664,
      "eval_objectnav_pose_rmse_dtheta": 0.05602360516786575,
      "eval_objectnav_pose_rmse_dx": 0.024227922782301903,
      "eval_objectnav_pose_rmse_dy": 0.009675338864326477,
      "eval_objectnav_pose_rmse_mean": 0.02997562289237976,
      "eval_objectnav_pose_rotation_flip": 0.014474512077867985,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2912047803401947,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 2200
    },
    {
      "epoch": 0.10221148485411634,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10399369895458221,
      "eval_pointnav_mae_dtheta": 0.011758974753320217,
      "eval_pointnav_mae_dx": 0.0029223905876278877,
      "eval_pointnav_mae_dy": 0.002779880305752158,
      "eval_pointnav_pose_mae_dtheta": 0.08189546316862106,
      "eval_pointnav_pose_mae_dx": 0.032538268715143204,
      "eval_pointnav_pose_mae_dy": 0.031117888167500496,
      "eval_pointnav_pose_rmse_dtheta": 0.21413654088974,
      "eval_pointnav_pose_rmse_dx": 0.09444443136453629,
      "eval_pointnav_pose_rmse_dy": 0.08647920191287994,
      "eval_pointnav_pose_rmse_mean": 0.131686732172966,
      "eval_pointnav_rmse_dtheta": 0.02677827887237072,
      "eval_pointnav_rmse_dx": 0.008770942687988281,
      "eval_pointnav_rmse_dy": 0.007249192334711552,
      "eval_pointnav_rmse_mean": 0.014266138896346092,
      "eval_pointnav_rotation_flip": 0.006027727387845516,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10399369895458221,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 2200
    },
    {
      "epoch": 0.10221148485411634,
      "eval_loss": 0.23810990154743195,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3191312253475189,
      "eval_objectnav_nopose_mae_dtheta": 0.041161730885505676,
      "eval_objectnav_nopose_mae_dx": 0.013845651410520077,
      "eval_objectnav_nopose_mae_dy": 0.0047957100905478,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.33326929807662964,
      "eval_objectnav_nopose_pose_mae_dx": 0.11257090419530869,
      "eval_objectnav_nopose_pose_mae_dy": 0.05443476140499115,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5518482327461243,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24449221789836884,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1290687769651413,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3084697723388672,
      "eval_objectnav_nopose_rmse_dtheta": 0.058661915361881256,
      "eval_objectnav_nopose_rmse_dx": 0.026660539209842682,
      "eval_objectnav_nopose_rmse_dy": 0.009853367693722248,
      "eval_objectnav_nopose_rmse_mean": 0.03172527626156807,
      "eval_objectnav_nopose_rotation_flip": 0.015218555927276611,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3191312253475189,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2912047803401947,
      "eval_objectnav_pose_mae_dtheta": 0.03770525008440018,
      "eval_objectnav_pose_mae_dx": 0.011792866513133049,
      "eval_objectnav_pose_mae_dy": 0.004634219687432051,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2936806082725525,
      "eval_objectnav_pose_pose_mae_dx": 0.09461215138435364,
      "eval_objectnav_pose_pose_mae_dy": 0.05107872188091278,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5126261115074158,
      "eval_objectnav_pose_pose_rmse_dx": 0.21710354089736938,
      "eval_objectnav_pose_pose_rmse_dy": 0.12043783813714981,
      "eval_objectnav_pose_pose_rmse_mean": 0.2833891808986664,
      "eval_objectnav_pose_rmse_dtheta": 0.05602360516786575,
      "eval_objectnav_pose_rmse_dx": 0.024227922782301903,
      "eval_objectnav_pose_rmse_dy": 0.009675338864326477,
      "eval_objectnav_pose_rmse_mean": 0.02997562289237976,
      "eval_objectnav_pose_rotation_flip": 0.014474512077867985,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2912047803401947,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10399369895458221,
      "eval_pointnav_mae_dtheta": 0.011758974753320217,
      "eval_pointnav_mae_dx": 0.0029223905876278877,
      "eval_pointnav_mae_dy": 0.002779880305752158,
      "eval_pointnav_pose_mae_dtheta": 0.08189546316862106,
      "eval_pointnav_pose_mae_dx": 0.032538268715143204,
      "eval_pointnav_pose_mae_dy": 0.031117888167500496,
      "eval_pointnav_pose_rmse_dtheta": 0.21413654088974,
      "eval_pointnav_pose_rmse_dx": 0.09444443136453629,
      "eval_pointnav_pose_rmse_dy": 0.08647920191287994,
      "eval_pointnav_pose_rmse_mean": 0.131686732172966,
      "eval_pointnav_rmse_dtheta": 0.02677827887237072,
      "eval_pointnav_rmse_dx": 0.008770942687988281,
      "eval_pointnav_rmse_dy": 0.007249192334711552,
      "eval_pointnav_rmse_mean": 0.014266138896346092,
      "eval_pointnav_rotation_flip": 0.006027727387845516,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10399369895458221,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 2200
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10225794461995912,
      "grad_norm": 0.5304359197616577,
      "learning_rate": 9.262509815116732e-06,
      "loss": 0.137,
      "mae_dtheta": 0.014101522043347359,
      "mae_dx": 0.00198463536798954,
      "mae_dy": 0.0025296693202108145,
      "pose_mae_dtheta": 0.10031427443027496,
      "pose_mae_dx": 0.026233110576868057,
      "pose_mae_dy": 0.03279697895050049,
      "pose_rmse_dtheta": 0.225969135761261,
      "pose_rmse_dx": 0.06489668786525726,
      "pose_rmse_dy": 0.07270754128694534,
      "pose_rmse_mean": 0.1211911290884018,
      "rmse_dtheta": 0.028015634045004845,
      "rmse_dx": 0.00619867816567421,
      "rmse_dy": 0.005396485328674316,
      "rmse_mean": 0.01320359855890274,
      "rotation_flip": 0.004914933815598488,
      "sparse_tokens": 32105.0,
      "step": 2201,
      "turn_loss": 0.09929922968149185,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24017.0,
      "epoch": 0.10230440438580189,
      "grad_norm": 0.540084183216095,
      "learning_rate": 9.261818510383403e-06,
      "loss": 0.1378,
      "mae_dtheta": 0.03908352553844452,
      "mae_dx": 0.010931693017482758,
      "mae_dy": 0.005550102796405554,
      "pose_mae_dtheta": 0.2863156199455261,
      "pose_mae_dx": 0.09614869207143784,
      "pose_mae_dy": 0.05746205523610115,
      "pose_rmse_dtheta": 0.5016852617263794,
      "pose_rmse_dx": 0.21861425042152405,
      "pose_rmse_dy": 0.1339903622865677,
      "pose_rmse_mean": 0.28476327657699585,
      "rmse_dtheta": 0.057905130088329315,
      "rmse_dx": 0.0225575789809227,
      "rmse_dy": 0.01165939774364233,
      "rmse_mean": 0.03070737048983574,
      "rotation_flip": 0.009740259498357773,
      "sparse_tokens": 19981.0,
      "step": 2202,
      "turn_loss": 0.3431868553161621,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 31466.0,
      "epoch": 0.10235086415164467,
      "grad_norm": 0.5902915000915527,
      "learning_rate": 9.261126907618818e-06,
      "loss": 0.2193,
      "mae_dtheta": 0.03611999377608299,
      "mae_dx": 0.013856620527803898,
      "mae_dy": 0.006975477561354637,
      "pose_mae_dtheta": 0.3006305992603302,
      "pose_mae_dx": 0.10953284054994583,
      "pose_mae_dy": 0.08588065952062607,
      "pose_rmse_dtheta": 0.5256391763687134,
      "pose_rmse_dx": 0.22536803781986237,
      "pose_rmse_dy": 0.20537254214286804,
      "pose_rmse_mean": 0.31879326701164246,
      "rmse_dtheta": 0.054408781230449677,
      "rmse_dx": 0.026729941368103027,
      "rmse_dy": 0.014999420382082462,
      "rmse_mean": 0.03204604983329773,
      "rotation_flip": 0.014566642232239246,
      "sparse_tokens": 25252.0,
      "step": 2203,
      "turn_loss": 0.32120007276535034,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.10239732391748746,
      "grad_norm": 1.031029462814331,
      "learning_rate": 9.26043500687134e-06,
      "loss": 0.2475,
      "mae_dtheta": 0.025348080322146416,
      "mae_dx": 0.005147623363882303,
      "mae_dy": 0.0026084054261446,
      "pose_mae_dtheta": 0.20176148414611816,
      "pose_mae_dx": 0.03491619974374771,
      "pose_mae_dy": 0.034706961363554,
      "pose_rmse_dtheta": 0.35133984684944153,
      "pose_rmse_dx": 0.07104212790727615,
      "pose_rmse_dy": 0.08431239426136017,
      "pose_rmse_mean": 0.16889813542366028,
      "rmse_dtheta": 0.04144430160522461,
      "rmse_dx": 0.013377644121646881,
      "rmse_dy": 0.0049825990572571754,
      "rmse_mean": 0.019934847950935364,
      "rotation_flip": 0.0035587188322097063,
      "sparse_tokens": 6300.0,
      "step": 2204,
      "turn_loss": 0.13676777482032776,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 13001.0,
      "epoch": 0.10244378368333024,
      "grad_norm": 0.813386857509613,
      "learning_rate": 9.259742808189358e-06,
      "loss": 0.2907,
      "mae_dtheta": 0.05090091750025749,
      "mae_dx": 0.012389185838401318,
      "mae_dy": 0.00458461232483387,
      "pose_mae_dtheta": 0.44105255603790283,
      "pose_mae_dx": 0.09761888533830643,
      "pose_mae_dy": 0.05873803794384003,
      "pose_rmse_dtheta": 0.7379434108734131,
      "pose_rmse_dx": 0.1969776749610901,
      "pose_rmse_dy": 0.11844991147518158,
      "pose_rmse_mean": 0.3511236608028412,
      "rmse_dtheta": 0.07301677018404007,
      "rmse_dx": 0.025002313777804375,
      "rmse_dy": 0.008539466187357903,
      "rmse_mean": 0.035519517958164215,
      "rotation_flip": 0.015600623562932014,
      "sparse_tokens": 10092.0,
      "step": 2205,
      "turn_loss": 0.31351909041404724,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.10249024344917301,
      "grad_norm": 0.5399919152259827,
      "learning_rate": 9.259050311621274e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.021730083972215652,
      "mae_dx": 0.0022145980037748814,
      "mae_dy": 0.0005976238753646612,
      "pose_mae_dtheta": 0.1897299885749817,
      "pose_mae_dx": 0.01517461147159338,
      "pose_mae_dy": 0.0035699503496289253,
      "pose_rmse_dtheta": 0.489728182554245,
      "pose_rmse_dx": 0.039941463619470596,
      "pose_rmse_dy": 0.006730085238814354,
      "pose_rmse_mean": 0.17879991233348846,
      "rmse_dtheta": 0.047993212938308716,
      "rmse_dx": 0.005376363173127174,
      "rmse_dy": 0.0010731305228546262,
      "rmse_mean": 0.01814756914973259,
      "rotation_flip": 0.0,
      "sparse_tokens": 2585.0,
      "step": 2206,
      "turn_loss": 0.07953234761953354,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.10253670321501579,
      "grad_norm": 0.5512586832046509,
      "learning_rate": 9.258357517215514e-06,
      "loss": 0.1811,
      "mae_dtheta": 0.029855409637093544,
      "mae_dx": 0.018544945865869522,
      "mae_dy": 0.005962365306913853,
      "pose_mae_dtheta": 0.22344247996807098,
      "pose_mae_dx": 0.16379249095916748,
      "pose_mae_dy": 0.08289383351802826,
      "pose_rmse_dtheta": 0.3696477711200714,
      "pose_rmse_dx": 0.3362615406513214,
      "pose_rmse_dy": 0.1634809821844101,
      "pose_rmse_mean": 0.28979676961898804,
      "rmse_dtheta": 0.04525761306285858,
      "rmse_dx": 0.03325991332530975,
      "rmse_dy": 0.010213674046099186,
      "rmse_mean": 0.029577067121863365,
      "rotation_flip": 0.020276498049497604,
      "sparse_tokens": 20310.0,
      "step": 2207,
      "turn_loss": 0.2605268061161041,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10258316298085858,
      "grad_norm": 0.7142053246498108,
      "learning_rate": 9.257664425020529e-06,
      "loss": 0.1948,
      "mae_dtheta": 0.014238300733268261,
      "mae_dx": 0.0022245885338634253,
      "mae_dy": 0.0029995362274348736,
      "pose_mae_dtheta": 0.10003212839365005,
      "pose_mae_dx": 0.028038809075951576,
      "pose_mae_dy": 0.03602495416998863,
      "pose_rmse_dtheta": 0.23543712496757507,
      "pose_rmse_dx": 0.06185067072510719,
      "pose_rmse_dy": 0.07629862427711487,
      "pose_rmse_mean": 0.12452881038188934,
      "rmse_dtheta": 0.028098007664084435,
      "rmse_dx": 0.005894263740628958,
      "rmse_dy": 0.0062347291968762875,
      "rmse_mean": 0.013408999890089035,
      "rotation_flip": 0.005149330478161573,
      "sparse_tokens": 32121.0,
      "step": 2208,
      "turn_loss": 0.1265946328639984,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.10262962274670136,
      "grad_norm": 0.6937792897224426,
      "learning_rate": 9.256971035084786e-06,
      "loss": 0.1892,
      "mae_dtheta": 0.03506699949502945,
      "mae_dx": 0.016586391255259514,
      "mae_dy": 0.004864406306296587,
      "pose_mae_dtheta": 0.30122286081314087,
      "pose_mae_dx": 0.13356898725032806,
      "pose_mae_dy": 0.060121819376945496,
      "pose_rmse_dtheta": 0.5127956867218018,
      "pose_rmse_dx": 0.2663557529449463,
      "pose_rmse_dy": 0.13820013403892517,
      "pose_rmse_mean": 0.30578386783599854,
      "rmse_dtheta": 0.05251498520374298,
      "rmse_dx": 0.02965587191283703,
      "rmse_dy": 0.010006008669734001,
      "rmse_mean": 0.030725624412298203,
      "rotation_flip": 0.020270269364118576,
      "sparse_tokens": 13929.0,
      "step": 2209,
      "turn_loss": 0.26948392391204834,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.10267608251254413,
      "grad_norm": 0.39404940605163574,
      "learning_rate": 9.256277347456773e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.030737116932868958,
      "mae_dx": 0.010962930507957935,
      "mae_dy": 0.0045253620482981205,
      "pose_mae_dtheta": 0.23931990563869476,
      "pose_mae_dx": 0.08681842684745789,
      "pose_mae_dy": 0.06410787999629974,
      "pose_rmse_dtheta": 0.43534812331199646,
      "pose_rmse_dx": 0.19257202744483948,
      "pose_rmse_dy": 0.1479179561138153,
      "pose_rmse_mean": 0.258612722158432,
      "rmse_dtheta": 0.04793471843004227,
      "rmse_dx": 0.023139027878642082,
      "rmse_dy": 0.009084912948310375,
      "rmse_mean": 0.026719553396105766,
      "rotation_flip": 0.012809564359486103,
      "sparse_tokens": 20815.0,
      "step": 2210,
      "turn_loss": 0.19731736183166504,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.10272254227838691,
      "grad_norm": 0.5873069763183594,
      "learning_rate": 9.255583362184998e-06,
      "loss": 0.113,
      "mae_dtheta": 0.035699263215065,
      "mae_dx": 0.009789112955331802,
      "mae_dy": 0.005930829793214798,
      "pose_mae_dtheta": 0.2833774983882904,
      "pose_mae_dx": 0.08288077265024185,
      "pose_mae_dy": 0.08434513956308365,
      "pose_rmse_dtheta": 0.4919104278087616,
      "pose_rmse_dx": 0.21468321979045868,
      "pose_rmse_dy": 0.1721753478050232,
      "pose_rmse_mean": 0.2929230034351349,
      "rmse_dtheta": 0.055025722831487656,
      "rmse_dx": 0.021644227206707,
      "rmse_dy": 0.010472293943166733,
      "rmse_mean": 0.029047414660453796,
      "rotation_flip": 0.01515151560306549,
      "sparse_tokens": 4853.0,
      "step": 2211,
      "turn_loss": 0.24670690298080444,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1027690020442297,
      "grad_norm": 0.40904128551483154,
      "learning_rate": 9.254889079318e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.008606059476733208,
      "mae_dx": 0.0013500958448275924,
      "mae_dy": 0.001923806848935783,
      "pose_mae_dtheta": 0.056430086493492126,
      "pose_mae_dx": 0.01757824420928955,
      "pose_mae_dy": 0.025079870596528053,
      "pose_rmse_dtheta": 0.11022099107503891,
      "pose_rmse_dx": 0.0457795187830925,
      "pose_rmse_dy": 0.05685519427061081,
      "pose_rmse_mean": 0.0709519013762474,
      "rmse_dtheta": 0.017778124660253525,
      "rmse_dx": 0.00394371198490262,
      "rmse_dy": 0.004299934487789869,
      "rmse_mean": 0.008673924021422863,
      "rotation_flip": 0.003703703638166189,
      "sparse_tokens": 32089.0,
      "step": 2212,
      "turn_loss": 0.07049093395471573,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1336.0,
      "epoch": 0.10281546181007248,
      "grad_norm": 0.8351613283157349,
      "learning_rate": 9.254194498904319e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.05006847903132439,
      "mae_dx": 0.03894547373056412,
      "mae_dy": 0.008466210216283798,
      "pose_mae_dtheta": 0.3628285229206085,
      "pose_mae_dx": 0.35902926325798035,
      "pose_mae_dy": 0.12390933185815811,
      "pose_rmse_dtheta": 0.524924099445343,
      "pose_rmse_dx": 0.5269342660903931,
      "pose_rmse_dy": 0.16988730430603027,
      "pose_rmse_mean": 0.4072485864162445,
      "rmse_dtheta": 0.05865136906504631,
      "rmse_dx": 0.049546096473932266,
      "rmse_dy": 0.010038767009973526,
      "rmse_mean": 0.03941207751631737,
      "rotation_flip": 0.05263157933950424,
      "sparse_tokens": 1159.0,
      "step": 2213,
      "turn_loss": 0.5280030965805054,
      "turns": 4.0,
      "turns_per_sample": 4.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.10286192157591525,
      "grad_norm": 0.4737860858440399,
      "learning_rate": 9.253499620992537e-06,
      "loss": 0.1037,
      "mae_dtheta": 0.009932244196534157,
      "mae_dx": 0.002309673000127077,
      "mae_dy": 0.0011797280749306083,
      "pose_mae_dtheta": 0.07274705916643143,
      "pose_mae_dx": 0.023266062140464783,
      "pose_mae_dy": 0.015516748651862144,
      "pose_rmse_dtheta": 0.21244896948337555,
      "pose_rmse_dx": 0.059010930359363556,
      "pose_rmse_dy": 0.0406908355653286,
      "pose_rmse_mean": 0.10405024886131287,
      "rmse_dtheta": 0.0271590705960989,
      "rmse_dx": 0.007065215613692999,
      "rmse_dy": 0.0028192622121423483,
      "rmse_mean": 0.012347850017249584,
      "rotation_flip": 0.00266808969900012,
      "sparse_tokens": 32137.0,
      "step": 2214,
      "turn_loss": 0.08404556661844254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.10290838134175803,
      "grad_norm": 0.5114176869392395,
      "learning_rate": 9.252804445631243e-06,
      "loss": 0.124,
      "mae_dtheta": 0.027978476136922836,
      "mae_dx": 0.008836956694722176,
      "mae_dy": 0.0037790595088154078,
      "pose_mae_dtheta": 0.23887017369270325,
      "pose_mae_dx": 0.07457493990659714,
      "pose_mae_dy": 0.058631185442209244,
      "pose_rmse_dtheta": 0.4223492443561554,
      "pose_rmse_dx": 0.1794123649597168,
      "pose_rmse_dy": 0.1355777233839035,
      "pose_rmse_mean": 0.24577978253364563,
      "rmse_dtheta": 0.04505398869514465,
      "rmse_dx": 0.020135944709181786,
      "rmse_dy": 0.008162720128893852,
      "rmse_mean": 0.024450886994600296,
      "rotation_flip": 0.009852216579020023,
      "sparse_tokens": 22613.0,
      "step": 2215,
      "turn_loss": 0.22794842720031738,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10295484110760082,
      "grad_norm": 0.46824565529823303,
      "learning_rate": 9.25210897286905e-06,
      "loss": 0.0865,
      "mae_dtheta": 0.008814908564090729,
      "mae_dx": 0.001624245778657496,
      "mae_dy": 0.0015209298580884933,
      "pose_mae_dtheta": 0.059511881321668625,
      "pose_mae_dx": 0.01903129369020462,
      "pose_mae_dy": 0.02521929331123829,
      "pose_rmse_dtheta": 0.12927213311195374,
      "pose_rmse_dx": 0.04590306431055069,
      "pose_rmse_dy": 0.060923993587493896,
      "pose_rmse_mean": 0.07869973033666611,
      "rmse_dtheta": 0.018715733662247658,
      "rmse_dx": 0.00499977171421051,
      "rmse_dy": 0.0033552234526723623,
      "rmse_mean": 0.009023576974868774,
      "rotation_flip": 0.00263968319632113,
      "sparse_tokens": 32089.0,
      "step": 2216,
      "turn_loss": 0.06680931150913239,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1030013008734436,
      "grad_norm": 0.4269685447216034,
      "learning_rate": 9.251413202754595e-06,
      "loss": 0.1213,
      "mae_dtheta": 0.011990795843303204,
      "mae_dx": 0.001304512144997716,
      "mae_dy": 0.002491493010893464,
      "pose_mae_dtheta": 0.07659685611724854,
      "pose_mae_dx": 0.020981205627322197,
      "pose_mae_dy": 0.03588437661528587,
      "pose_rmse_dtheta": 0.14702172577381134,
      "pose_rmse_dx": 0.05011555179953575,
      "pose_rmse_dy": 0.0783085897564888,
      "pose_rmse_mean": 0.0918152928352356,
      "rmse_dtheta": 0.022067997604608536,
      "rmse_dx": 0.0036220750771462917,
      "rmse_dy": 0.0046151177957654,
      "rmse_mean": 0.010101730935275555,
      "rotation_flip": 0.005638474132865667,
      "sparse_tokens": 32089.0,
      "step": 2217,
      "turn_loss": 0.0834336206316948,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.10304776063928638,
      "grad_norm": 0.6685649752616882,
      "learning_rate": 9.250717135336533e-06,
      "loss": 0.1695,
      "mae_dtheta": 0.037629541009664536,
      "mae_dx": 0.016476983204483986,
      "mae_dy": 0.0059432112611830235,
      "pose_mae_dtheta": 0.32034096121788025,
      "pose_mae_dx": 0.1234121322631836,
      "pose_mae_dy": 0.0716886892914772,
      "pose_rmse_dtheta": 0.48181840777397156,
      "pose_rmse_dx": 0.25113987922668457,
      "pose_rmse_dy": 0.16806596517562866,
      "pose_rmse_mean": 0.3003414273262024,
      "rmse_dtheta": 0.05121627822518349,
      "rmse_dx": 0.030216069892048836,
      "rmse_dy": 0.010168771259486675,
      "rmse_mean": 0.03053370676934719,
      "rotation_flip": 0.013487475924193859,
      "sparse_tokens": 9008.0,
      "step": 2218,
      "turn_loss": 0.37190842628479004,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.10309422040512915,
      "grad_norm": 0.6575043201446533,
      "learning_rate": 9.250020770663541e-06,
      "loss": 0.17,
      "mae_dtheta": 0.03252049908041954,
      "mae_dx": 0.012366324663162231,
      "mae_dy": 0.005718472879379988,
      "pose_mae_dtheta": 0.25271573662757874,
      "pose_mae_dx": 0.08418560028076172,
      "pose_mae_dy": 0.06156465411186218,
      "pose_rmse_dtheta": 0.4520898163318634,
      "pose_rmse_dx": 0.18477225303649902,
      "pose_rmse_dy": 0.1404391974210739,
      "pose_rmse_mean": 0.25910043716430664,
      "rmse_dtheta": 0.05042874068021774,
      "rmse_dx": 0.024490147829055786,
      "rmse_dy": 0.010758536867797375,
      "rmse_mean": 0.028559140861034393,
      "rotation_flip": 0.008527131751179695,
      "sparse_tokens": 20532.0,
      "step": 2219,
      "turn_loss": 0.2984329164028168,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.10314068017097194,
      "grad_norm": 0.5334527492523193,
      "learning_rate": 9.249324108784315e-06,
      "loss": 0.0858,
      "mae_dtheta": 0.04528272897005081,
      "mae_dx": 0.0114315589889884,
      "mae_dy": 0.0025572809390723705,
      "pose_mae_dtheta": 0.3860477805137634,
      "pose_mae_dx": 0.07479356974363327,
      "pose_mae_dy": 0.013649688102304935,
      "pose_rmse_dtheta": 0.619330644607544,
      "pose_rmse_dx": 0.171800896525383,
      "pose_rmse_dy": 0.02699545957148075,
      "pose_rmse_mean": 0.2727090120315552,
      "rmse_dtheta": 0.06477780640125275,
      "rmse_dx": 0.02352178283035755,
      "rmse_dy": 0.005249527283012867,
      "rmse_mean": 0.031183039769530296,
      "rotation_flip": 0.03465346619486809,
      "sparse_tokens": 3296.0,
      "step": 2220,
      "turn_loss": 0.25886860489845276,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.10318713993681472,
      "grad_norm": 0.6103676557540894,
      "learning_rate": 9.248627149747573e-06,
      "loss": 0.151,
      "mae_dtheta": 0.038957592099905014,
      "mae_dx": 0.017110181972384453,
      "mae_dy": 0.005821800325065851,
      "pose_mae_dtheta": 0.3221236765384674,
      "pose_mae_dx": 0.13787400722503662,
      "pose_mae_dy": 0.09861845523118973,
      "pose_rmse_dtheta": 0.5420511960983276,
      "pose_rmse_dx": 0.29223060607910156,
      "pose_rmse_dy": 0.1935296207666397,
      "pose_rmse_mean": 0.34260380268096924,
      "rmse_dtheta": 0.05527732893824577,
      "rmse_dx": 0.03135286644101143,
      "rmse_dy": 0.009699374437332153,
      "rmse_mean": 0.032109856605529785,
      "rotation_flip": 0.007407407276332378,
      "sparse_tokens": 15590.0,
      "step": 2221,
      "turn_loss": 0.3640967011451721,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1032335997026575,
      "grad_norm": 0.6551441550254822,
      "learning_rate": 9.247929893602054e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.011697955429553986,
      "mae_dx": 0.0023532328195869923,
      "mae_dy": 0.0034722008276730776,
      "pose_mae_dtheta": 0.07848430424928665,
      "pose_mae_dx": 0.03321528434753418,
      "pose_mae_dy": 0.03631696477532387,
      "pose_rmse_dtheta": 0.1625235676765442,
      "pose_rmse_dx": 0.07923559099435806,
      "pose_rmse_dy": 0.07925920188426971,
      "pose_rmse_mean": 0.10700611770153046,
      "rmse_dtheta": 0.023904500529170036,
      "rmse_dx": 0.006316391285508871,
      "rmse_dy": 0.007822055369615555,
      "rmse_mean": 0.012680983170866966,
      "rotation_flip": 0.0063492064364254475,
      "sparse_tokens": 32105.0,
      "step": 2222,
      "turn_loss": 0.10688473284244537,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10328005946850027,
      "grad_norm": 0.4328746497631073,
      "learning_rate": 9.247232340396517e-06,
      "loss": 0.1058,
      "mae_dtheta": 0.009032012894749641,
      "mae_dx": 0.0015373033238574862,
      "mae_dy": 0.001919482252560556,
      "pose_mae_dtheta": 0.06880417466163635,
      "pose_mae_dx": 0.021938171237707138,
      "pose_mae_dy": 0.028582990169525146,
      "pose_rmse_dtheta": 0.18537798523902893,
      "pose_rmse_dx": 0.05633926764130592,
      "pose_rmse_dy": 0.0691634863615036,
      "pose_rmse_mean": 0.10362690687179565,
      "rmse_dtheta": 0.02233998291194439,
      "rmse_dx": 0.004293140489608049,
      "rmse_dy": 0.004429692402482033,
      "rmse_mean": 0.010354272089898586,
      "rotation_flip": 0.0017263703048229218,
      "sparse_tokens": 32089.0,
      "step": 2223,
      "turn_loss": 0.0700056180357933,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1980.0,
      "epoch": 0.10332651923434306,
      "grad_norm": 1.199028730392456,
      "learning_rate": 9.246534490179744e-06,
      "loss": 0.2862,
      "mae_dtheta": 0.03513023629784584,
      "mae_dx": 0.021468115970492363,
      "mae_dy": 0.015522358939051628,
      "pose_mae_dtheta": 0.3396635353565216,
      "pose_mae_dx": 0.18074116110801697,
      "pose_mae_dy": 0.2110910713672638,
      "pose_rmse_dtheta": 0.6150845289230347,
      "pose_rmse_dx": 0.2984868884086609,
      "pose_rmse_dy": 0.3020465672016144,
      "pose_rmse_mean": 0.40520602464675903,
      "rmse_dtheta": 0.05508515611290932,
      "rmse_dx": 0.03606798127293587,
      "rmse_dy": 0.020556200295686722,
      "rmse_mean": 0.037236448377370834,
      "rotation_flip": 0.0,
      "sparse_tokens": 1757.0,
      "step": 2224,
      "turn_loss": 0.37059685587882996,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 18452.0,
      "epoch": 0.10337297900018584,
      "grad_norm": 0.6727086305618286,
      "learning_rate": 9.245836343000534e-06,
      "loss": 0.2076,
      "mae_dtheta": 0.03148268535733223,
      "mae_dx": 0.010983046144247055,
      "mae_dy": 0.005006685387343168,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6727088093757629,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.43971252441406,
      "model/head/act_norm_mean": 107.91312020285088,
      "model/head/act_norm_min": 74.34651184082031,
      "model/head/act_over_embed": 74.15890650194798,
      "model/head/grad_frac": 0.10825329273939133,
      "model/head/grad_norm": 0.0728229433298111,
      "model/head/grad_zero_frac": 0.00019702577264979482,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6878940515350878,
      "model/head/update_ratio": 0.0012616929598152637,
      "model/head/weight_delta": 5.414134979248047,
      "model/head/weight_delta_rel": 0.09497996419668198,
      "model/head/weight_norm": 57.71843719482422,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41430172324180603,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41430172324180603,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41430172324180603,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2847120229656129,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07158952206373215,
      "model/modality_embedder.encoders.pose/grad_norm": 0.048158902674913406,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015651514986529946,
      "model/modality_embedder.encoders.pose/weight_delta": 1.7593410015106201,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05748315528035164,
      "model/modality_embedder.encoders.pose/weight_norm": 30.76948356628418,
      "model/modality_embedder/grad_frac": 0.07158952206373215,
      "model/modality_embedder/grad_norm": 0.048158902674913406,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0015651514986529946,
      "model/modality_embedder/weight_delta": 1.7593410015106201,
      "model/modality_embedder/weight_delta_rel": 0.05748315528035164,
      "model/modality_embedder/weight_norm": 30.76948356628418,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.95045471191406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.266586605402395,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.157570838928223,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.989016140448218,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0894949808716774,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06020406261086464,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002179719740524888,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.097989797592163,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04001140967011452,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.620094299316406,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.69757843017578,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.177235623781677,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.739065170288086,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.614822671508893,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09081985801458359,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06109531968832016,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002092797541990876,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.3736337423324585,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.047583747655153275,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.193134307861328,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.17896270751953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.908227600250626,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.31546688079834,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.804376563540565,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09325172007083893,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06273125112056732,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002081984421238303,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.4655201435089111,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04920942336320877,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.130508422851562,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 78.4531478881836,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.891962980367584,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.290205001831055,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.167618088780173,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10124059021472931,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06810543686151505,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0023077328223735094,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.2513316869735718,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0427645780146122,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.511838912963867,
      "model/normalizer/grad_frac": 0.4240548312664032,
      "model/normalizer/grad_norm": 0.28526541590690613,
      "model/normalizer/grad_zero_frac": 0.00019380509911570698,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0036568462383002043,
      "model/normalizer/weight_delta": 2.671802520751953,
      "model/normalizer/weight_delta_rel": 0.034411270171403885,
      "model/normalizer/weight_norm": 78.00859069824219,
      "pose_mae_dtheta": 0.2361004501581192,
      "pose_mae_dx": 0.08006090670824051,
      "pose_mae_dy": 0.06438178569078445,
      "pose_rmse_dtheta": 0.4337891936302185,
      "pose_rmse_dx": 0.17536050081253052,
      "pose_rmse_dy": 0.1417515128850937,
      "pose_rmse_mean": 0.25030040740966797,
      "rmse_dtheta": 0.04968749359250069,
      "rmse_dx": 0.022911150008440018,
      "rmse_dy": 0.009372428059577942,
      "rmse_mean": 0.027323691174387932,
      "rotation_flip": 0.011325028724968433,
      "sparse_tokens": 15591.0,
      "step": 2225,
      "turn_loss": 0.251339316368103,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.10341943876602862,
      "grad_norm": 0.7391254305839539,
      "learning_rate": 9.24513789890771e-06,
      "loss": 0.1326,
      "mae_dtheta": 0.0075347586534917355,
      "mae_dx": 0.0017725119832903147,
      "mae_dy": 0.0009543201304040849,
      "pose_mae_dtheta": 0.05696292221546173,
      "pose_mae_dx": 0.016518153250217438,
      "pose_mae_dy": 0.013990852050483227,
      "pose_rmse_dtheta": 0.20168189704418182,
      "pose_rmse_dx": 0.04035576805472374,
      "pose_rmse_dy": 0.02904397062957287,
      "pose_rmse_mean": 0.09036054462194443,
      "rmse_dtheta": 0.023471906781196594,
      "rmse_dx": 0.005023075733333826,
      "rmse_dy": 0.0025575212202966213,
      "rmse_mean": 0.01035083457827568,
      "rotation_flip": 0.00146484375,
      "sparse_tokens": 32185.0,
      "step": 2226,
      "turn_loss": 0.05814409628510475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31790.0,
      "epoch": 0.1034658985318714,
      "grad_norm": 0.4829027056694031,
      "learning_rate": 9.244439157950114e-06,
      "loss": 0.1561,
      "mae_dtheta": 0.0328170582652092,
      "mae_dx": 0.014377899467945099,
      "mae_dy": 0.005398300942033529,
      "pose_mae_dtheta": 0.25817567110061646,
      "pose_mae_dx": 0.10240577906370163,
      "pose_mae_dy": 0.0688585638999939,
      "pose_rmse_dtheta": 0.4576067626476288,
      "pose_rmse_dx": 0.22173331677913666,
      "pose_rmse_dy": 0.17223483324050903,
      "pose_rmse_mean": 0.2838582992553711,
      "rmse_dtheta": 0.05038496479392052,
      "rmse_dx": 0.027178484946489334,
      "rmse_dy": 0.01126361545175314,
      "rmse_mean": 0.02960902266204357,
      "rotation_flip": 0.01738525740802288,
      "sparse_tokens": 24799.0,
      "step": 2227,
      "turn_loss": 0.2520047426223755,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.10351235829771419,
      "grad_norm": 0.7019822001457214,
      "learning_rate": 9.24374012017661e-06,
      "loss": 0.1648,
      "mae_dtheta": 0.03147752210497856,
      "mae_dx": 0.013952463865280151,
      "mae_dy": 0.0039991941303014755,
      "pose_mae_dtheta": 0.2316993623971939,
      "pose_mae_dx": 0.11215665191411972,
      "pose_mae_dy": 0.05233301967382431,
      "pose_rmse_dtheta": 0.4433823823928833,
      "pose_rmse_dx": 0.2496999353170395,
      "pose_rmse_dy": 0.12341486662626266,
      "pose_rmse_mean": 0.2721657454967499,
      "rmse_dtheta": 0.05101682245731354,
      "rmse_dx": 0.02808481454849243,
      "rmse_dy": 0.0075715649873018265,
      "rmse_mean": 0.02889106795191765,
      "rotation_flip": 0.006613756529986858,
      "sparse_tokens": 14040.0,
      "step": 2228,
      "turn_loss": 0.20003531873226166,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.10355881806355696,
      "grad_norm": 0.5872076749801636,
      "learning_rate": 9.243040785636081e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.04066174849867821,
      "mae_dx": 0.015717320144176483,
      "mae_dy": 0.006573149934411049,
      "pose_mae_dtheta": 0.33013758063316345,
      "pose_mae_dx": 0.11982849985361099,
      "pose_mae_dy": 0.07380853593349457,
      "pose_rmse_dtheta": 0.5123878121376038,
      "pose_rmse_dx": 0.24331103265285492,
      "pose_rmse_dy": 0.16846300661563873,
      "pose_rmse_mean": 0.30805397033691406,
      "rmse_dtheta": 0.05554613098502159,
      "rmse_dx": 0.02806309424340725,
      "rmse_dy": 0.011930374428629875,
      "rmse_mean": 0.031846534460783005,
      "rotation_flip": 0.006734006572514772,
      "sparse_tokens": 9476.0,
      "step": 2229,
      "turn_loss": 0.3391255736351013,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.10360527782939974,
      "grad_norm": 0.4654484689235687,
      "learning_rate": 9.242341154377432e-06,
      "loss": 0.121,
      "mae_dtheta": 0.01154214795678854,
      "mae_dx": 0.00234646862372756,
      "mae_dy": 0.003033136483281851,
      "pose_mae_dtheta": 0.08359408378601074,
      "pose_mae_dx": 0.03153427317738533,
      "pose_mae_dy": 0.035045549273490906,
      "pose_rmse_dtheta": 0.21099808812141418,
      "pose_rmse_dx": 0.09000159054994583,
      "pose_rmse_dy": 0.08647214621305466,
      "pose_rmse_mean": 0.12915727496147156,
      "rmse_dtheta": 0.02470717765390873,
      "rmse_dx": 0.006936955731362104,
      "rmse_dy": 0.006853732280433178,
      "rmse_mean": 0.012832622043788433,
      "rotation_flip": 0.0064452155493199825,
      "sparse_tokens": 32057.0,
      "step": 2230,
      "turn_loss": 0.09291501343250275,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10365173759524252,
      "grad_norm": 0.44697868824005127,
      "learning_rate": 9.241641226449592e-06,
      "loss": 0.1188,
      "mae_dtheta": 0.015975041314959526,
      "mae_dx": 0.002895649988204241,
      "mae_dy": 0.003425715956836939,
      "pose_mae_dtheta": 0.12346283346414566,
      "pose_mae_dx": 0.03496288135647774,
      "pose_mae_dy": 0.04346100613474846,
      "pose_rmse_dtheta": 0.25776413083076477,
      "pose_rmse_dx": 0.08552706986665726,
      "pose_rmse_dy": 0.10735674202442169,
      "pose_rmse_mean": 0.1502159833908081,
      "rmse_dtheta": 0.03140869364142418,
      "rmse_dx": 0.00827015656977892,
      "rmse_dy": 0.008346247486770153,
      "rmse_mean": 0.016008365899324417,
      "rotation_flip": 0.004548900760710239,
      "sparse_tokens": 32121.0,
      "step": 2231,
      "turn_loss": 0.12515105307102203,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9085.0,
      "epoch": 0.1036981973610853,
      "grad_norm": 0.6299945116043091,
      "learning_rate": 9.240941001901501e-06,
      "loss": 0.1836,
      "mae_dtheta": 0.03610771894454956,
      "mae_dx": 0.013500192202627659,
      "mae_dy": 0.004089815076440573,
      "pose_mae_dtheta": 0.29299983382225037,
      "pose_mae_dx": 0.11704150587320328,
      "pose_mae_dy": 0.058152470737695694,
      "pose_rmse_dtheta": 0.47111281752586365,
      "pose_rmse_dx": 0.2575920820236206,
      "pose_rmse_dy": 0.12794624269008636,
      "pose_rmse_mean": 0.28555041551589966,
      "rmse_dtheta": 0.05020560696721077,
      "rmse_dx": 0.025841107591986656,
      "rmse_dy": 0.007105630356818438,
      "rmse_mean": 0.02771744877099991,
      "rotation_flip": 0.011037527583539486,
      "sparse_tokens": 7774.0,
      "step": 2232,
      "turn_loss": 0.2694462239742279,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.10374465712692808,
      "grad_norm": 0.5006341934204102,
      "learning_rate": 9.24024048078213e-06,
      "loss": 0.0919,
      "mae_dtheta": 0.009145263582468033,
      "mae_dx": 0.002013624645769596,
      "mae_dy": 0.00027412737836129963,
      "pose_mae_dtheta": 0.0692056342959404,
      "pose_mae_dx": 0.01633194461464882,
      "pose_mae_dy": 0.00409540394321084,
      "pose_rmse_dtheta": 0.27206945419311523,
      "pose_rmse_dx": 0.03911183774471283,
      "pose_rmse_dy": 0.008591573685407639,
      "pose_rmse_mean": 0.10659095644950867,
      "rmse_dtheta": 0.03163482993841171,
      "rmse_dx": 0.005455575883388519,
      "rmse_dy": 0.00047717211418785155,
      "rmse_mean": 0.01252252608537674,
      "rotation_flip": 0.0013280212879180908,
      "sparse_tokens": 32201.0,
      "step": 2233,
      "turn_loss": 0.04736020043492317,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.10379111689277086,
      "grad_norm": 0.5075482726097107,
      "learning_rate": 9.239539663140468e-06,
      "loss": 0.1108,
      "mae_dtheta": 0.015412012115120888,
      "mae_dx": 0.0021117432042956352,
      "mae_dy": 0.0037118669133633375,
      "pose_mae_dtheta": 0.10604150593280792,
      "pose_mae_dx": 0.03310340642929077,
      "pose_mae_dy": 0.04744440317153931,
      "pose_rmse_dtheta": 0.21679560840129852,
      "pose_rmse_dx": 0.08239533752202988,
      "pose_rmse_dy": 0.11235224455595016,
      "pose_rmse_mean": 0.13718107342720032,
      "rmse_dtheta": 0.02815423533320427,
      "rmse_dx": 0.00661783292889595,
      "rmse_dy": 0.00795725081115961,
      "rmse_mean": 0.014243106357753277,
      "rotation_flip": 0.005343511234968901,
      "sparse_tokens": 32073.0,
      "step": 2234,
      "turn_loss": 0.11983109265565872,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.10383757665861364,
      "grad_norm": 0.42218154668807983,
      "learning_rate": 9.23883854902552e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.008793001063168049,
      "mae_dx": 0.002005076501518488,
      "mae_dy": 0.001427874551154673,
      "pose_mae_dtheta": 0.0674365982413292,
      "pose_mae_dx": 0.018633605912327766,
      "pose_mae_dy": 0.018764285370707512,
      "pose_rmse_dtheta": 0.21092571318149567,
      "pose_rmse_dx": 0.053295496851205826,
      "pose_rmse_dy": 0.05383632332086563,
      "pose_rmse_mean": 0.10601918399333954,
      "rmse_dtheta": 0.0242049191147089,
      "rmse_dx": 0.006274511571973562,
      "rmse_dy": 0.005055050365626812,
      "rmse_mean": 0.01184482779353857,
      "rotation_flip": 0.004682622384279966,
      "sparse_tokens": 32169.0,
      "step": 2235,
      "turn_loss": 0.06880056113004684,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.10388403642445643,
      "grad_norm": 0.5298065543174744,
      "learning_rate": 9.238137138486318e-06,
      "loss": 0.1888,
      "mae_dtheta": 0.010375083424150944,
      "mae_dx": 0.0016976248007267714,
      "mae_dy": 0.0021295591723173857,
      "pose_mae_dtheta": 0.07293179631233215,
      "pose_mae_dx": 0.02631818689405918,
      "pose_mae_dy": 0.027386832982301712,
      "pose_rmse_dtheta": 0.19469425082206726,
      "pose_rmse_dx": 0.06849260628223419,
      "pose_rmse_dy": 0.0641687884926796,
      "pose_rmse_mean": 0.10911855101585388,
      "rmse_dtheta": 0.023587802425026894,
      "rmse_dx": 0.005097107961773872,
      "rmse_dy": 0.004745287820696831,
      "rmse_mean": 0.011143399402499199,
      "rotation_flip": 0.0033860045950859785,
      "sparse_tokens": 32041.0,
      "step": 2236,
      "turn_loss": 0.07321318984031677,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1039304961902992,
      "grad_norm": 0.5182176232337952,
      "learning_rate": 9.237435431571911e-06,
      "loss": 0.1796,
      "mae_dtheta": 0.01170319877564907,
      "mae_dx": 0.0018470408394932747,
      "mae_dy": 0.0015388168394565582,
      "pose_mae_dtheta": 0.0847887396812439,
      "pose_mae_dx": 0.01982450671494007,
      "pose_mae_dy": 0.020428918302059174,
      "pose_rmse_dtheta": 0.2560851275920868,
      "pose_rmse_dx": 0.04808752238750458,
      "pose_rmse_dy": 0.05127418413758278,
      "pose_rmse_mean": 0.11848227679729462,
      "rmse_dtheta": 0.030316833406686783,
      "rmse_dx": 0.005432760808616877,
      "rmse_dy": 0.003993735183030367,
      "rmse_mean": 0.0132477767765522,
      "rotation_flip": 0.0018903592135757208,
      "sparse_tokens": 32153.0,
      "step": 2237,
      "turn_loss": 0.08811520040035248,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10397695595614198,
      "grad_norm": 0.5140541195869446,
      "learning_rate": 9.236733428331371e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.011638736352324486,
      "mae_dx": 0.002472863532602787,
      "mae_dy": 0.002572282450273633,
      "pose_mae_dtheta": 0.07911579310894012,
      "pose_mae_dx": 0.025195246562361717,
      "pose_mae_dy": 0.035478536039590836,
      "pose_rmse_dtheta": 0.16236668825149536,
      "pose_rmse_dx": 0.06492280960083008,
      "pose_rmse_dy": 0.07618516683578491,
      "pose_rmse_mean": 0.10115822404623032,
      "rmse_dtheta": 0.023274507373571396,
      "rmse_dx": 0.007462780922651291,
      "rmse_dy": 0.005543710198253393,
      "rmse_mean": 0.012093666009604931,
      "rotation_flip": 0.004494382068514824,
      "sparse_tokens": 32121.0,
      "step": 2238,
      "turn_loss": 0.10864613950252533,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.10402341572198476,
      "grad_norm": 0.9222652316093445,
      "learning_rate": 9.236031128813786e-06,
      "loss": 0.3006,
      "mae_dtheta": 0.0332864448428154,
      "mae_dx": 0.01520006638020277,
      "mae_dy": 0.005335488822311163,
      "pose_mae_dtheta": 0.27220043540000916,
      "pose_mae_dx": 0.11755877733230591,
      "pose_mae_dy": 0.06610922515392303,
      "pose_rmse_dtheta": 0.4946340322494507,
      "pose_rmse_dx": 0.25469890236854553,
      "pose_rmse_dy": 0.14562658965587616,
      "pose_rmse_mean": 0.29831984639167786,
      "rmse_dtheta": 0.05045527219772339,
      "rmse_dx": 0.028230180963873863,
      "rmse_dy": 0.010568558238446712,
      "rmse_mean": 0.029751338064670563,
      "rotation_flip": 0.013179571367800236,
      "sparse_tokens": 12665.0,
      "step": 2239,
      "turn_loss": 0.3014003038406372,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10406987548782753,
      "grad_norm": 0.3862302005290985,
      "learning_rate": 9.235328533068272e-06,
      "loss": 0.0926,
      "mae_dtheta": 0.009425828233361244,
      "mae_dx": 0.002116489689797163,
      "mae_dy": 0.0024722088128328323,
      "pose_mae_dtheta": 0.06870999187231064,
      "pose_mae_dx": 0.02344558574259281,
      "pose_mae_dy": 0.023919882252812386,
      "pose_rmse_dtheta": 0.20114083588123322,
      "pose_rmse_dx": 0.06001165881752968,
      "pose_rmse_dy": 0.055228833109140396,
      "pose_rmse_mean": 0.10546045005321503,
      "rmse_dtheta": 0.022855425253510475,
      "rmse_dx": 0.006351969204843044,
      "rmse_dy": 0.005720644257962704,
      "rmse_mean": 0.011642679572105408,
      "rotation_flip": 0.005442176945507526,
      "sparse_tokens": 32089.0,
      "step": 2240,
      "turn_loss": 0.07797528058290482,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.10411633525367033,
      "grad_norm": 1.2833105325698853,
      "learning_rate": 9.234625641143962e-06,
      "loss": 0.2867,
      "mae_dtheta": 0.03822922334074974,
      "mae_dx": 0.009593300521373749,
      "mae_dy": 0.0035973601043224335,
      "pose_mae_dtheta": 0.28263598680496216,
      "pose_mae_dx": 0.08143788576126099,
      "pose_mae_dy": 0.044307779520750046,
      "pose_rmse_dtheta": 0.508610188961029,
      "pose_rmse_dx": 0.1565232276916504,
      "pose_rmse_dy": 0.09139885753393173,
      "pose_rmse_mean": 0.2521774172782898,
      "rmse_dtheta": 0.056604914367198944,
      "rmse_dx": 0.018932431936264038,
      "rmse_dy": 0.007494816556572914,
      "rmse_mean": 0.02767738699913025,
      "rotation_flip": 0.008695651777088642,
      "sparse_tokens": 9853.0,
      "step": 2241,
      "turn_loss": 0.2834409475326538,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1041627950195131,
      "grad_norm": 0.6136887073516846,
      "learning_rate": 9.233922453090006e-06,
      "loss": 0.1637,
      "mae_dtheta": 0.008286937139928341,
      "mae_dx": 0.0014446196146309376,
      "mae_dy": 0.001073921099305153,
      "pose_mae_dtheta": 0.05800134316086769,
      "pose_mae_dx": 0.014234000816941261,
      "pose_mae_dy": 0.013825853355228901,
      "pose_rmse_dtheta": 0.19758987426757812,
      "pose_rmse_dx": 0.03679070249199867,
      "pose_rmse_dy": 0.04906667023897171,
      "pose_rmse_mean": 0.0944824144244194,
      "rmse_dtheta": 0.025767121464014053,
      "rmse_dx": 0.004515680484473705,
      "rmse_dy": 0.0034170891158282757,
      "rmse_mean": 0.011233298107981682,
      "rotation_flip": 0.004226095974445343,
      "sparse_tokens": 32153.0,
      "step": 2242,
      "turn_loss": 0.05267121270298958,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.10420925478535588,
      "grad_norm": 0.6860659122467041,
      "learning_rate": 9.233218968955582e-06,
      "loss": 0.0919,
      "mae_dtheta": 0.032526180148124695,
      "mae_dx": 0.013895401731133461,
      "mae_dy": 0.004514094442129135,
      "pose_mae_dtheta": 0.2494046986103058,
      "pose_mae_dx": 0.12450466305017471,
      "pose_mae_dy": 0.0516432449221611,
      "pose_rmse_dtheta": 0.42765963077545166,
      "pose_rmse_dx": 0.2852230668067932,
      "pose_rmse_dy": 0.13197709619998932,
      "pose_rmse_mean": 0.28161993622779846,
      "rmse_dtheta": 0.04728008806705475,
      "rmse_dx": 0.02764982357621193,
      "rmse_dy": 0.00885179452598095,
      "rmse_mean": 0.027927234768867493,
      "rotation_flip": 0.01595744676887989,
      "sparse_tokens": 6903.0,
      "step": 2243,
      "turn_loss": 0.2950102686882019,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.10425571455119866,
      "grad_norm": 0.4247935116291046,
      "learning_rate": 9.23251518878988e-06,
      "loss": 0.084,
      "mae_dtheta": 0.02587760239839554,
      "mae_dx": 0.013951415196061134,
      "mae_dy": 0.004553897771984339,
      "pose_mae_dtheta": 0.18304450809955597,
      "pose_mae_dx": 0.10210907459259033,
      "pose_mae_dy": 0.04830754175782204,
      "pose_rmse_dtheta": 0.3436484932899475,
      "pose_rmse_dx": 0.23354564607143402,
      "pose_rmse_dy": 0.11537487804889679,
      "pose_rmse_mean": 0.23085634410381317,
      "rmse_dtheta": 0.044642191380262375,
      "rmse_dx": 0.027191881090402603,
      "rmse_dy": 0.009950573556125164,
      "rmse_mean": 0.02726154774427414,
      "rotation_flip": 0.008474576286971569,
      "sparse_tokens": 5332.0,
      "step": 2244,
      "turn_loss": 0.1761016547679901,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.10430217431704145,
      "grad_norm": 0.5302077531814575,
      "learning_rate": 9.231811112642121e-06,
      "loss": 0.1372,
      "mae_dtheta": 0.04386921972036362,
      "mae_dx": 0.016159508377313614,
      "mae_dy": 0.004948366433382034,
      "pose_mae_dtheta": 0.3644985556602478,
      "pose_mae_dx": 0.11656561493873596,
      "pose_mae_dy": 0.062586210668087,
      "pose_rmse_dtheta": 0.6058374643325806,
      "pose_rmse_dx": 0.22899691760540009,
      "pose_rmse_dy": 0.1424582153558731,
      "pose_rmse_mean": 0.3257642090320587,
      "rmse_dtheta": 0.0628437027335167,
      "rmse_dx": 0.028459258377552032,
      "rmse_dy": 0.008596130646765232,
      "rmse_mean": 0.03329969942569733,
      "rotation_flip": 0.013574660755693913,
      "sparse_tokens": 7308.0,
      "step": 2245,
      "turn_loss": 0.20105870068073273,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10434863408288422,
      "grad_norm": 0.672630786895752,
      "learning_rate": 9.231106740561541e-06,
      "loss": 0.098,
      "mae_dtheta": 0.0074365343898534775,
      "mae_dx": 0.0021606413647532463,
      "mae_dy": 0.0010194856440648437,
      "pose_mae_dtheta": 0.05416855961084366,
      "pose_mae_dx": 0.019498953595757484,
      "pose_mae_dy": 0.016089947894215584,
      "pose_rmse_dtheta": 0.1800239235162735,
      "pose_rmse_dx": 0.05436495691537857,
      "pose_rmse_dy": 0.05180006101727486,
      "pose_rmse_mean": 0.09539632499217987,
      "rmse_dtheta": 0.021469706669449806,
      "rmse_dx": 0.0069411927834153175,
      "rmse_dy": 0.002989167347550392,
      "rmse_mean": 0.010466690175235271,
      "rotation_flip": 0.004511278122663498,
      "sparse_tokens": 32121.0,
      "step": 2246,
      "turn_loss": 0.06385258585214615,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.104395093848727,
      "grad_norm": 0.6645615100860596,
      "learning_rate": 9.230402072597396e-06,
      "loss": 0.1066,
      "mae_dtheta": 0.029302259907126427,
      "mae_dx": 0.005212207790464163,
      "mae_dy": 0.0025069734547287226,
      "pose_mae_dtheta": 0.23295775055885315,
      "pose_mae_dx": 0.04300859197974205,
      "pose_mae_dy": 0.042095575481653214,
      "pose_rmse_dtheta": 0.4155905246734619,
      "pose_rmse_dx": 0.10338714718818665,
      "pose_rmse_dy": 0.10958537459373474,
      "pose_rmse_mean": 0.20952102541923523,
      "rmse_dtheta": 0.04474985972046852,
      "rmse_dx": 0.014797749929130077,
      "rmse_dy": 0.004732053726911545,
      "rmse_mean": 0.021426554769277573,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 4339.0,
      "step": 2247,
      "turn_loss": 0.19324900209903717,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.10444155361456978,
      "grad_norm": 0.5046238899230957,
      "learning_rate": 9.22969710879896e-06,
      "loss": 0.1457,
      "mae_dtheta": 0.03950636088848114,
      "mae_dx": 0.011595755815505981,
      "mae_dy": 0.00924074649810791,
      "pose_mae_dtheta": 0.33121100068092346,
      "pose_mae_dx": 0.1024349108338356,
      "pose_mae_dy": 0.11108539998531342,
      "pose_rmse_dtheta": 0.5430746078491211,
      "pose_rmse_dx": 0.2069186121225357,
      "pose_rmse_dy": 0.2548699378967285,
      "pose_rmse_mean": 0.3349543809890747,
      "rmse_dtheta": 0.05598495528101921,
      "rmse_dx": 0.022177111357450485,
      "rmse_dy": 0.016567809507250786,
      "rmse_mean": 0.031576626002788544,
      "rotation_flip": 0.007619047537446022,
      "sparse_tokens": 18933.0,
      "step": 2248,
      "turn_loss": 0.362282931804657,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10448801338041257,
      "grad_norm": 0.47237852215766907,
      "learning_rate": 9.228991849215539e-06,
      "loss": 0.1142,
      "mae_dtheta": 0.011346526443958282,
      "mae_dx": 0.002116041723638773,
      "mae_dy": 0.002950134454295039,
      "pose_mae_dtheta": 0.0774654671549797,
      "pose_mae_dx": 0.023911427706480026,
      "pose_mae_dy": 0.03283396735787392,
      "pose_rmse_dtheta": 0.20361711084842682,
      "pose_rmse_dx": 0.06198709085583687,
      "pose_rmse_dy": 0.07788988202810287,
      "pose_rmse_mean": 0.11449803411960602,
      "rmse_dtheta": 0.024228841066360474,
      "rmse_dx": 0.0061311908066272736,
      "rmse_dy": 0.007776017766445875,
      "rmse_mean": 0.012712016701698303,
      "rotation_flip": 0.005605380982160568,
      "sparse_tokens": 32089.0,
      "step": 2249,
      "turn_loss": 0.0947326123714447,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.10453447314625534,
      "grad_norm": 1.257155179977417,
      "learning_rate": 9.228286293896444e-06,
      "loss": 0.2133,
      "mae_dtheta": 0.012392179109156132,
      "mae_dx": 0.0021318166982382536,
      "mae_dy": 0.0029523454140871763,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999991655349731,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.84007263183594,
      "model/head/act_norm_mean": 109.39265703914141,
      "model/head/act_norm_min": 66.20210266113281,
      "model/head/act_over_embed": 75.17565806748892,
      "model/head/grad_frac": 0.0754794031381607,
      "model/head/grad_norm": 0.07547934353351593,
      "model/head/grad_zero_frac": 0.00018401762645225972,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6954210069444444,
      "model/head/update_ratio": 0.0013075637398287654,
      "model/head/weight_delta": 5.447360515594482,
      "model/head/weight_delta_rel": 0.09556283801794052,
      "model/head/weight_norm": 57.72517395019531,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41450294852256775,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4144270936464934,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4143354892730713,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28479817868145024,
      "model/modality_embedder.encoders.pose/grad_frac": 0.03439102694392204,
      "model/modality_embedder.encoders.pose/grad_norm": 0.034390997141599655,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.4883352534562212,
      "model/modality_embedder.encoders.pose/update_ratio": 0.00111759128049016,
      "model/modality_embedder.encoders.pose/weight_delta": 1.7654134035110474,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05768155679106712,
      "model/modality_embedder.encoders.pose/weight_norm": 30.772428512573242,
      "model/modality_embedder/grad_frac": 0.03439102694392204,
      "model/modality_embedder/grad_norm": 0.034390997141599655,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.4883352534562212,
      "model/modality_embedder/update_ratio": 0.00111759128049016,
      "model/modality_embedder/weight_delta": 1.7654134035110474,
      "model/modality_embedder/weight_delta_rel": 0.05768155679106712,
      "model/modality_embedder/weight_norm": 30.772428512573242,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.02764892578125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.39694063652397,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.877068519592285,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.07859665102863,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07626775652170181,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.07626768946647644,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0027610685210675,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.1100176572799683,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04044971242547035,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.622526168823242,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.29743194580078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.45224567099567,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.148747444152832,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.803812150638976,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06541881710290909,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06541876494884491,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0022406280040740967,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.3872780799865723,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04805639758706093,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.19662094116211,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.04917907714844,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.4024671316338,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.06771469116211,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.144022596650476,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06372338533401489,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06372333317995071,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0021146852523088455,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.481001853942871,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.04972926899790764,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.13372039794922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.65780639648438,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.253815436107104,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.320841789245605,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.416286484080437,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.057928040623664856,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.057927992194890976,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019626645371317863,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.26371431350708,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.043187759816646576,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.514972686767578,
      "model/normalizer/grad_frac": 0.21287426352500916,
      "model/normalizer/grad_norm": 0.21287408471107483,
      "model/normalizer/grad_zero_frac": 0.00017135207599494606,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0027287194970995188,
      "model/normalizer/weight_delta": 2.699106216430664,
      "model/normalizer/weight_delta_rel": 0.034762926399707794,
      "model/normalizer/weight_norm": 78.01244354248047,
      "pose_mae_dtheta": 0.08507842570543289,
      "pose_mae_dx": 0.030042873695492744,
      "pose_mae_dy": 0.036953795701265335,
      "pose_rmse_dtheta": 0.1786012500524521,
      "pose_rmse_dx": 0.07016772031784058,
      "pose_rmse_dy": 0.07761745154857635,
      "pose_rmse_mean": 0.10879547894001007,
      "rmse_dtheta": 0.024468423798680305,
      "rmse_dx": 0.006680965423583984,
      "rmse_dy": 0.005485583562403917,
      "rmse_mean": 0.01221165806055069,
      "rotation_flip": 0.004519774112850428,
      "sparse_tokens": 32057.0,
      "step": 2250,
      "turn_loss": 0.0982694998383522,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10458093291209812,
      "grad_norm": 0.3652174174785614,
      "learning_rate": 9.227580442891022e-06,
      "loss": 0.106,
      "mae_dtheta": 0.008064360357820988,
      "mae_dx": 0.0016007792437449098,
      "mae_dy": 0.0014918230008333921,
      "pose_mae_dtheta": 0.06365545839071274,
      "pose_mae_dx": 0.018683234229683876,
      "pose_mae_dy": 0.0207841619849205,
      "pose_rmse_dtheta": 0.1962793618440628,
      "pose_rmse_dx": 0.06264838576316833,
      "pose_rmse_dy": 0.07259780168533325,
      "pose_rmse_mean": 0.1105085238814354,
      "rmse_dtheta": 0.022755106911063194,
      "rmse_dx": 0.0054168119095265865,
      "rmse_dy": 0.00441757682710886,
      "rmse_mean": 0.010863165371119976,
      "rotation_flip": 0.0038546256255358458,
      "sparse_tokens": 32121.0,
      "step": 2251,
      "turn_loss": 0.05402260646224022,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6843.0,
      "epoch": 0.1046273926779409,
      "grad_norm": 0.49189653992652893,
      "learning_rate": 9.226874296248628e-06,
      "loss": 0.0936,
      "mae_dtheta": 0.03289533406496048,
      "mae_dx": 0.015902811661362648,
      "mae_dy": 0.00294683501124382,
      "pose_mae_dtheta": 0.2582900822162628,
      "pose_mae_dx": 0.13087616860866547,
      "pose_mae_dy": 0.030364008620381355,
      "pose_rmse_dtheta": 0.478635311126709,
      "pose_rmse_dx": 0.271954745054245,
      "pose_rmse_dy": 0.06230265647172928,
      "pose_rmse_mean": 0.27096426486968994,
      "rmse_dtheta": 0.05129595845937729,
      "rmse_dx": 0.02917209081351757,
      "rmse_dy": 0.0055070784874260426,
      "rmse_mean": 0.02865837886929512,
      "rotation_flip": 0.0060240961611270905,
      "sparse_tokens": 5232.0,
      "step": 2252,
      "turn_loss": 0.3257330060005188,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10467385244378369,
      "grad_norm": 0.4997076988220215,
      "learning_rate": 9.22616785401865e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.012301625683903694,
      "mae_dx": 0.0017315908335149288,
      "mae_dy": 0.002541211200878024,
      "pose_mae_dtheta": 0.08655659109354019,
      "pose_mae_dx": 0.026548177003860474,
      "pose_mae_dy": 0.03306330740451813,
      "pose_rmse_dtheta": 0.22794759273529053,
      "pose_rmse_dx": 0.07847795635461807,
      "pose_rmse_dy": 0.09579385817050934,
      "pose_rmse_mean": 0.1340731382369995,
      "rmse_dtheta": 0.026612496003508568,
      "rmse_dx": 0.005108230281621218,
      "rmse_dy": 0.005804655607789755,
      "rmse_mean": 0.012508461251854897,
      "rotation_flip": 0.005066956393420696,
      "sparse_tokens": 32121.0,
      "step": 2253,
      "turn_loss": 0.08957325667142868,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.10472031220962646,
      "grad_norm": 0.48684751987457275,
      "learning_rate": 9.225461116250483e-06,
      "loss": 0.1156,
      "mae_dtheta": 0.009596554562449455,
      "mae_dx": 0.001818247139453888,
      "mae_dy": 0.00035953609040006995,
      "pose_mae_dtheta": 0.06688510626554489,
      "pose_mae_dx": 0.01429777778685093,
      "pose_mae_dy": 0.005445138551294804,
      "pose_rmse_dtheta": 0.25678062438964844,
      "pose_rmse_dx": 0.029055872932076454,
      "pose_rmse_dy": 0.0115010691806674,
      "pose_rmse_mean": 0.09911252558231354,
      "rmse_dtheta": 0.03234477341175079,
      "rmse_dx": 0.004545201547443867,
      "rmse_dy": 0.0006503150216303766,
      "rmse_mean": 0.012513430789113045,
      "rotation_flip": 0.0,
      "sparse_tokens": 32265.0,
      "step": 2254,
      "turn_loss": 0.06257826834917068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.10476677197546924,
      "grad_norm": 0.5212545394897461,
      "learning_rate": 9.224754082993553e-06,
      "loss": 0.117,
      "mae_dtheta": 0.01261195633560419,
      "mae_dx": 0.0024020420387387276,
      "mae_dy": 0.0021034665405750275,
      "pose_mae_dtheta": 0.08391483873128891,
      "pose_mae_dx": 0.026550015434622765,
      "pose_mae_dy": 0.029909208416938782,
      "pose_rmse_dtheta": 0.20559759438037872,
      "pose_rmse_dx": 0.061627332121133804,
      "pose_rmse_dy": 0.06938674300909042,
      "pose_rmse_mean": 0.11220389604568481,
      "rmse_dtheta": 0.026702187955379486,
      "rmse_dx": 0.007076490204781294,
      "rmse_dy": 0.004404769279062748,
      "rmse_mean": 0.01272781565785408,
      "rotation_flip": 0.00781555287539959,
      "sparse_tokens": 32153.0,
      "step": 2255,
      "turn_loss": 0.11378254741430283,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.10481323174131202,
      "grad_norm": 0.5118077397346497,
      "learning_rate": 9.2240467542973e-06,
      "loss": 0.1482,
      "mae_dtheta": 0.011401905678212643,
      "mae_dx": 0.0019011349650099874,
      "mae_dy": 0.001971085090190172,
      "pose_mae_dtheta": 0.07425349950790405,
      "pose_mae_dx": 0.021173378452658653,
      "pose_mae_dy": 0.02099866420030594,
      "pose_rmse_dtheta": 0.1990370899438858,
      "pose_rmse_dx": 0.055658020079135895,
      "pose_rmse_dy": 0.04965764656662941,
      "pose_rmse_mean": 0.10145092010498047,
      "rmse_dtheta": 0.026600733399391174,
      "rmse_dx": 0.0057573565281927586,
      "rmse_dy": 0.004832717124372721,
      "rmse_mean": 0.012396937236189842,
      "rotation_flip": 0.0017488632583990693,
      "sparse_tokens": 32185.0,
      "step": 2256,
      "turn_loss": 0.09383172541856766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.10485969150715481,
      "grad_norm": 1.5604593753814697,
      "learning_rate": 9.223339130211194e-06,
      "loss": 0.2652,
      "mae_dtheta": 0.031532835215330124,
      "mae_dx": 0.0069817351177334785,
      "mae_dy": 0.0035800309851765633,
      "pose_mae_dtheta": 0.25588110089302063,
      "pose_mae_dx": 0.06287576258182526,
      "pose_mae_dy": 0.0565425381064415,
      "pose_rmse_dtheta": 0.4743233621120453,
      "pose_rmse_dx": 0.17833496630191803,
      "pose_rmse_dy": 0.18194587528705597,
      "pose_rmse_mean": 0.2782014012336731,
      "rmse_dtheta": 0.0526173897087574,
      "rmse_dx": 0.01872137561440468,
      "rmse_dy": 0.008416258729994297,
      "rmse_mean": 0.026585008949041367,
      "rotation_flip": 0.0021834061481058598,
      "sparse_tokens": 8116.0,
      "step": 2257,
      "turn_loss": 0.19855615496635437,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.10490615127299759,
      "grad_norm": 0.8258014917373657,
      "learning_rate": 9.222631210784712e-06,
      "loss": 0.1628,
      "mae_dtheta": 0.021313434466719627,
      "mae_dx": 0.011471638455986977,
      "mae_dy": 0.0021143120247870684,
      "pose_mae_dtheta": 0.1632862091064453,
      "pose_mae_dx": 0.09868679195642471,
      "pose_mae_dy": 0.025559930130839348,
      "pose_rmse_dtheta": 0.2856976091861725,
      "pose_rmse_dx": 0.27536311745643616,
      "pose_rmse_dy": 0.057833991944789886,
      "pose_rmse_mean": 0.20629823207855225,
      "rmse_dtheta": 0.034689173102378845,
      "rmse_dx": 0.02531828172504902,
      "rmse_dy": 0.004856958985328674,
      "rmse_mean": 0.021621471270918846,
      "rotation_flip": 0.009049774147570133,
      "sparse_tokens": 4668.0,
      "step": 2258,
      "turn_loss": 0.1138070821762085,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.10495261103884036,
      "grad_norm": 0.6348615288734436,
      "learning_rate": 9.221922996067365e-06,
      "loss": 0.1326,
      "mae_dtheta": 0.030130628496408463,
      "mae_dx": 0.012817410752177238,
      "mae_dy": 0.004561810288578272,
      "pose_mae_dtheta": 0.22418561577796936,
      "pose_mae_dx": 0.09577595442533493,
      "pose_mae_dy": 0.0481068380177021,
      "pose_rmse_dtheta": 0.43031659722328186,
      "pose_rmse_dx": 0.22024276852607727,
      "pose_rmse_dy": 0.11771949380636215,
      "pose_rmse_mean": 0.25609296560287476,
      "rmse_dtheta": 0.048228900879621506,
      "rmse_dx": 0.025871016085147858,
      "rmse_dy": 0.01009886059910059,
      "rmse_mean": 0.028066258877515793,
      "rotation_flip": 0.008917197585105896,
      "sparse_tokens": 13854.0,
      "step": 2259,
      "turn_loss": 0.2902889549732208,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.10499907080468314,
      "grad_norm": 0.5045866966247559,
      "learning_rate": 9.221214486108675e-06,
      "loss": 0.1492,
      "mae_dtheta": 0.029651977121829987,
      "mae_dx": 0.009242682717740536,
      "mae_dy": 0.003258168464526534,
      "pose_mae_dtheta": 0.21314580738544464,
      "pose_mae_dx": 0.07930921763181686,
      "pose_mae_dy": 0.029516519978642464,
      "pose_rmse_dtheta": 0.4306913912296295,
      "pose_rmse_dx": 0.20651231706142426,
      "pose_rmse_dy": 0.06667441129684448,
      "pose_rmse_mean": 0.23462603986263275,
      "rmse_dtheta": 0.0468234159052372,
      "rmse_dx": 0.021391186863183975,
      "rmse_dy": 0.007146844174712896,
      "rmse_mean": 0.025120481848716736,
      "rotation_flip": 0.007352941203862429,
      "sparse_tokens": 7702.0,
      "step": 2260,
      "turn_loss": 0.22607222199440002,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.10504553057052593,
      "grad_norm": 0.5662665963172913,
      "learning_rate": 9.220505680958194e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.028754763305187225,
      "mae_dx": 0.008901005610823631,
      "mae_dy": 0.005413970910012722,
      "pose_mae_dtheta": 0.19685348868370056,
      "pose_mae_dx": 0.07282037287950516,
      "pose_mae_dy": 0.05769532173871994,
      "pose_rmse_dtheta": 0.35347872972488403,
      "pose_rmse_dx": 0.16987738013267517,
      "pose_rmse_dy": 0.12433281540870667,
      "pose_rmse_mean": 0.21589629352092743,
      "rmse_dtheta": 0.045000575482845306,
      "rmse_dx": 0.01976783387362957,
      "rmse_dy": 0.009544312953948975,
      "rmse_mean": 0.024770908057689667,
      "rotation_flip": 0.015837104991078377,
      "sparse_tokens": 15684.0,
      "step": 2261,
      "turn_loss": 0.24158887565135956,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.1050919903363687,
      "grad_norm": 0.5790489912033081,
      "learning_rate": 9.219796580665483e-06,
      "loss": 0.1512,
      "mae_dtheta": 0.03898985683917999,
      "mae_dx": 0.00695244362577796,
      "mae_dy": 0.004420994780957699,
      "pose_mae_dtheta": 0.34207549691200256,
      "pose_mae_dx": 0.06264699995517731,
      "pose_mae_dy": 0.044856250286102295,
      "pose_rmse_dtheta": 0.6348507404327393,
      "pose_rmse_dx": 0.12988239526748657,
      "pose_rmse_dy": 0.08516690135002136,
      "pose_rmse_mean": 0.2833000123500824,
      "rmse_dtheta": 0.06199885904788971,
      "rmse_dx": 0.015606013126671314,
      "rmse_dy": 0.008817227557301521,
      "rmse_mean": 0.028807368129491806,
      "rotation_flip": 0.019607843831181526,
      "sparse_tokens": 5157.0,
      "step": 2262,
      "turn_loss": 0.280071884393692,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.10513845010221148,
      "grad_norm": 0.5471548438072205,
      "learning_rate": 9.219087185280132e-06,
      "loss": 0.1718,
      "mae_dtheta": 0.04422217607498169,
      "mae_dx": 0.0165720097720623,
      "mae_dy": 0.004171911161392927,
      "pose_mae_dtheta": 0.36943817138671875,
      "pose_mae_dx": 0.12372434139251709,
      "pose_mae_dy": 0.04819011315703392,
      "pose_rmse_dtheta": 0.6121944785118103,
      "pose_rmse_dx": 0.2638096511363983,
      "pose_rmse_dy": 0.108696848154068,
      "pose_rmse_mean": 0.32823365926742554,
      "rmse_dtheta": 0.061929136514663696,
      "rmse_dx": 0.02959311753511429,
      "rmse_dy": 0.007738339714705944,
      "rmse_mean": 0.0330868661403656,
      "rotation_flip": 0.01770833320915699,
      "sparse_tokens": 15797.0,
      "step": 2263,
      "turn_loss": 0.264302134513855,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.10518490986805426,
      "grad_norm": 0.729646623134613,
      "learning_rate": 9.21837749485175e-06,
      "loss": 0.1463,
      "mae_dtheta": 0.03662998229265213,
      "mae_dx": 0.017781151458621025,
      "mae_dy": 0.005602092482149601,
      "pose_mae_dtheta": 0.2971043288707733,
      "pose_mae_dx": 0.13840115070343018,
      "pose_mae_dy": 0.07703274488449097,
      "pose_rmse_dtheta": 0.5097417235374451,
      "pose_rmse_dx": 0.2763514816761017,
      "pose_rmse_dy": 0.1684572398662567,
      "pose_rmse_mean": 0.3181835114955902,
      "rmse_dtheta": 0.053984880447387695,
      "rmse_dx": 0.030797669664025307,
      "rmse_dy": 0.010833550244569778,
      "rmse_mean": 0.03187203407287598,
      "rotation_flip": 0.020636284723877907,
      "sparse_tokens": 18733.0,
      "step": 2264,
      "turn_loss": 0.27500641345977783,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10523136963389705,
      "grad_norm": 0.8914483189582825,
      "learning_rate": 9.217667509429966e-06,
      "loss": 0.1925,
      "mae_dtheta": 0.0111998924985528,
      "mae_dx": 0.001747508067637682,
      "mae_dy": 0.003112630918622017,
      "pose_mae_dtheta": 0.07332715392112732,
      "pose_mae_dx": 0.02706097438931465,
      "pose_mae_dy": 0.03656454384326935,
      "pose_rmse_dtheta": 0.14108772575855255,
      "pose_rmse_dx": 0.06680134683847427,
      "pose_rmse_dy": 0.0898687019944191,
      "pose_rmse_mean": 0.0992525964975357,
      "rmse_dtheta": 0.021153781563043594,
      "rmse_dx": 0.004410714842379093,
      "rmse_dy": 0.007047033868730068,
      "rmse_mean": 0.010870510712265968,
      "rotation_flip": 0.0027729636058211327,
      "sparse_tokens": 32105.0,
      "step": 2265,
      "turn_loss": 0.09391222149133682,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10527782939973983,
      "grad_norm": 0.5221152901649475,
      "learning_rate": 9.21695722906443e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.012772412039339542,
      "mae_dx": 0.001780303893610835,
      "mae_dy": 0.002967677777633071,
      "pose_mae_dtheta": 0.09543078392744064,
      "pose_mae_dx": 0.025750625878572464,
      "pose_mae_dy": 0.040830954909324646,
      "pose_rmse_dtheta": 0.2339540719985962,
      "pose_rmse_dx": 0.060195762664079666,
      "pose_rmse_dy": 0.10455001145601273,
      "pose_rmse_mean": 0.1328999549150467,
      "rmse_dtheta": 0.026848403736948967,
      "rmse_dx": 0.004964484833180904,
      "rmse_dy": 0.006834132131189108,
      "rmse_mean": 0.012882339768111706,
      "rotation_flip": 0.005285013001412153,
      "sparse_tokens": 32121.0,
      "step": 2266,
      "turn_loss": 0.10204140096902847,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.1053242891655826,
      "grad_norm": 0.8012501001358032,
      "learning_rate": 9.21624665380481e-06,
      "loss": 0.1704,
      "mae_dtheta": 0.030860131606459618,
      "mae_dx": 0.009920324198901653,
      "mae_dy": 0.00409757299348712,
      "pose_mae_dtheta": 0.2516668438911438,
      "pose_mae_dx": 0.08960180729627609,
      "pose_mae_dy": 0.05539369583129883,
      "pose_rmse_dtheta": 0.45066991448402405,
      "pose_rmse_dx": 0.1843305379152298,
      "pose_rmse_dy": 0.11648774147033691,
      "pose_rmse_mean": 0.2504960894584656,
      "rmse_dtheta": 0.046874821186065674,
      "rmse_dx": 0.020870143547654152,
      "rmse_dy": 0.007915725000202656,
      "rmse_mean": 0.025220230221748352,
      "rotation_flip": 0.011111111380159855,
      "sparse_tokens": 17909.0,
      "step": 2267,
      "turn_loss": 0.2505421042442322,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.10537074893142538,
      "grad_norm": 0.44959375262260437,
      "learning_rate": 9.2155357837008e-06,
      "loss": 0.1456,
      "mae_dtheta": 0.014541913755238056,
      "mae_dx": 0.005023914389312267,
      "mae_dy": 0.005756606347858906,
      "pose_mae_dtheta": 0.10517729073762894,
      "pose_mae_dx": 0.055917516350746155,
      "pose_mae_dy": 0.04742861166596413,
      "pose_rmse_dtheta": 0.23754337430000305,
      "pose_rmse_dx": 0.16376399993896484,
      "pose_rmse_dy": 0.10954445600509644,
      "pose_rmse_mean": 0.1702839583158493,
      "rmse_dtheta": 0.028388600796461105,
      "rmse_dx": 0.014178918674588203,
      "rmse_dy": 0.012572974897921085,
      "rmse_mean": 0.018380165100097656,
      "rotation_flip": 0.005045045167207718,
      "sparse_tokens": 32073.0,
      "step": 2268,
      "turn_loss": 0.1608731746673584,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.10541720869726817,
      "grad_norm": 0.9563620686531067,
      "learning_rate": 9.214824618802108e-06,
      "loss": 0.2515,
      "mae_dtheta": 0.03486623987555504,
      "mae_dx": 0.01844649948179722,
      "mae_dy": 0.007135535590350628,
      "pose_mae_dtheta": 0.25255903601646423,
      "pose_mae_dx": 0.15618237853050232,
      "pose_mae_dy": 0.07695655524730682,
      "pose_rmse_dtheta": 0.47138217091560364,
      "pose_rmse_dx": 0.3070852756500244,
      "pose_rmse_dy": 0.18165478110313416,
      "pose_rmse_mean": 0.320040762424469,
      "rmse_dtheta": 0.052452582865953445,
      "rmse_dx": 0.03196574002504349,
      "rmse_dy": 0.016138557344675064,
      "rmse_mean": 0.0335189625620842,
      "rotation_flip": 0.010064044035971165,
      "sparse_tokens": 19871.0,
      "step": 2269,
      "turn_loss": 0.3401767313480377,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.10546366846311095,
      "grad_norm": 0.5882794260978699,
      "learning_rate": 9.21411315915847e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.0274940375238657,
      "mae_dx": 0.011292134411633015,
      "mae_dy": 0.005187699571251869,
      "pose_mae_dtheta": 0.22834615409374237,
      "pose_mae_dx": 0.07131237536668777,
      "pose_mae_dy": 0.06414276361465454,
      "pose_rmse_dtheta": 0.36569127440452576,
      "pose_rmse_dx": 0.17158351838588715,
      "pose_rmse_dy": 0.15553848445415497,
      "pose_rmse_mean": 0.23093776404857635,
      "rmse_dtheta": 0.04158930853009224,
      "rmse_dx": 0.023010890930891037,
      "rmse_dy": 0.01013917662203312,
      "rmse_mean": 0.02491312474012375,
      "rotation_flip": 0.011363636702299118,
      "sparse_tokens": 5512.0,
      "step": 2270,
      "turn_loss": 0.22222748398780823,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.10551012822895373,
      "grad_norm": 1.077067255973816,
      "learning_rate": 9.213401404819636e-06,
      "loss": 0.3067,
      "mae_dtheta": 0.046376146376132965,
      "mae_dx": 0.009578550234436989,
      "mae_dy": 0.0073648723773658276,
      "pose_mae_dtheta": 0.3834545612335205,
      "pose_mae_dx": 0.07529642432928085,
      "pose_mae_dy": 0.0695207491517067,
      "pose_rmse_dtheta": 0.6455714702606201,
      "pose_rmse_dx": 0.15379740297794342,
      "pose_rmse_dy": 0.12907792627811432,
      "pose_rmse_mean": 0.30948227643966675,
      "rmse_dtheta": 0.06850498169660568,
      "rmse_dx": 0.019621510058641434,
      "rmse_dy": 0.01345614530146122,
      "rmse_mean": 0.03386088088154793,
      "rotation_flip": 0.017369726672768593,
      "sparse_tokens": 7370.0,
      "step": 2271,
      "turn_loss": 0.4048295021057129,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.1055565879947965,
      "grad_norm": 0.8697484731674194,
      "learning_rate": 9.21268935583538e-06,
      "loss": 0.1851,
      "mae_dtheta": 0.03491801396012306,
      "mae_dx": 0.01195716392248869,
      "mae_dy": 0.005227629095315933,
      "pose_mae_dtheta": 0.24440591037273407,
      "pose_mae_dx": 0.1052974984049797,
      "pose_mae_dy": 0.0636516809463501,
      "pose_rmse_dtheta": 0.41455113887786865,
      "pose_rmse_dx": 0.25923895835876465,
      "pose_rmse_dy": 0.14829817414283752,
      "pose_rmse_mean": 0.2740294337272644,
      "rmse_dtheta": 0.05068836361169815,
      "rmse_dx": 0.025723451748490334,
      "rmse_dy": 0.009448150172829628,
      "rmse_mean": 0.02861998789012432,
      "rotation_flip": 0.014534884132444859,
      "sparse_tokens": 12222.0,
      "step": 2272,
      "turn_loss": 0.30665624141693115,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1056030477606393,
      "grad_norm": 0.4483973979949951,
      "learning_rate": 9.211977012255497e-06,
      "loss": 0.0973,
      "mae_dtheta": 0.013405255042016506,
      "mae_dx": 0.001501759048551321,
      "mae_dy": 0.0027843588031828403,
      "pose_mae_dtheta": 0.08691868185997009,
      "pose_mae_dx": 0.025791537016630173,
      "pose_mae_dy": 0.04107501730322838,
      "pose_rmse_dtheta": 0.16837932169437408,
      "pose_rmse_dx": 0.06495396792888641,
      "pose_rmse_dy": 0.09851285070180893,
      "pose_rmse_mean": 0.11061538755893707,
      "rmse_dtheta": 0.02312570996582508,
      "rmse_dx": 0.004884932655841112,
      "rmse_dy": 0.005204990040510893,
      "rmse_mean": 0.011071877554059029,
      "rotation_flip": 0.0044037941843271255,
      "sparse_tokens": 32089.0,
      "step": 2273,
      "turn_loss": 0.09427856653928757,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.10564950752648207,
      "grad_norm": 0.47163546085357666,
      "learning_rate": 9.211264374129802e-06,
      "loss": 0.0843,
      "mae_dtheta": 0.03910304233431816,
      "mae_dx": 0.014370054006576538,
      "mae_dy": 0.01179851870983839,
      "pose_mae_dtheta": 0.3066323697566986,
      "pose_mae_dx": 0.12656119465827942,
      "pose_mae_dy": 0.12288574874401093,
      "pose_rmse_dtheta": 0.5283980369567871,
      "pose_rmse_dx": 0.2758983373641968,
      "pose_rmse_dy": 0.24996721744537354,
      "pose_rmse_mean": 0.35142120718955994,
      "rmse_dtheta": 0.060180775821208954,
      "rmse_dx": 0.02746790088713169,
      "rmse_dy": 0.022139834240078926,
      "rmse_mean": 0.03659617155790329,
      "rotation_flip": 0.012135921977460384,
      "sparse_tokens": 6914.0,
      "step": 2274,
      "turn_loss": 0.4734063446521759,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.10569596729232485,
      "grad_norm": 1.0631978511810303,
      "learning_rate": 9.210551441508126e-06,
      "loss": 0.1208,
      "mae_dtheta": 0.009725410491228104,
      "mae_dx": 0.0022471107076853514,
      "mae_dy": 0.002102508209645748,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999991059303284,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 168.07518005371094,
      "model/head/act_norm_mean": 126.27202690972223,
      "model/head/act_norm_min": 74.17294311523438,
      "model/head/act_over_embed": 86.77531906970255,
      "model/head/grad_frac": 0.06498745828866959,
      "model/head/grad_norm": 0.06498739868402481,
      "model/head/grad_zero_frac": 0.00019290123600512743,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6919635811237373,
      "model/head/update_ratio": 0.0011256501311436296,
      "model/head/weight_delta": 5.478883743286133,
      "model/head/weight_delta_rel": 0.0961158499121666,
      "model/head/weight_norm": 57.73321533203125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4144647419452667,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4143894894022337,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41432344913482666,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2847723366927385,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10577612370252609,
      "model/modality_embedder.encoders.pose/grad_norm": 0.10577602684497833,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5057310005868545,
      "model/modality_embedder.encoders.pose/update_ratio": 0.003437221748754382,
      "model/modality_embedder.encoders.pose/weight_delta": 1.7785167694091797,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05810968577861786,
      "model/modality_embedder.encoders.pose/weight_norm": 30.773698806762695,
      "model/modality_embedder/grad_frac": 0.10577612370252609,
      "model/modality_embedder/grad_norm": 0.10577602684497833,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5057310005868545,
      "model/modality_embedder/update_ratio": 0.003437221748754382,
      "model/modality_embedder/weight_delta": 1.7785167694091797,
      "model/modality_embedder/weight_delta_rel": 0.05810968577861786,
      "model/modality_embedder/weight_norm": 30.773698806762695,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 93.27978515625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.015269260060926,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.012307167053223,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.190727232154508,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05546855181455612,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05546850338578224,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020079310052096844,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.118706464767456,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.040766339749097824,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.624704360961914,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 94.62359619140625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.045680014430015,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.035792350769043,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.89883514941442,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05836482718586922,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05836477503180504,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.00199876818805933,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.4003063440322876,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.048507705330848694,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.20037078857422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 96.32335662841797,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.939920033670035,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.394011497497559,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.200574624790626,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05699528381228447,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05699523165822029,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018911577062681317,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.4950796365737915,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05020197480916977,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.137746810913086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.99137115478516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.73160173160173,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.99697494506836,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.431835061597624,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.059576161205768585,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05957610905170441,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020183506421744823,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.275308609008789,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.04358399659395218,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.517223358154297,
      "model/normalizer/grad_frac": 0.23085856437683105,
      "model/normalizer/grad_norm": 0.23085835576057434,
      "model/normalizer/grad_zero_frac": 0.00018435118545312434,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002959085162729025,
      "model/normalizer/weight_delta": 2.7237303256988525,
      "model/normalizer/weight_delta_rel": 0.035080067813396454,
      "model/normalizer/weight_norm": 78.01679992675781,
      "pose_mae_dtheta": 0.07325109839439392,
      "pose_mae_dx": 0.02636127732694149,
      "pose_mae_dy": 0.02333427406847477,
      "pose_rmse_dtheta": 0.23290106654167175,
      "pose_rmse_dx": 0.07595990598201752,
      "pose_rmse_dy": 0.06617207080125809,
      "pose_rmse_mean": 0.12501101195812225,
      "rmse_dtheta": 0.026028847321867943,
      "rmse_dx": 0.007488280534744263,
      "rmse_dy": 0.005690606310963631,
      "rmse_mean": 0.013069245032966137,
      "rotation_flip": 0.004286589100956917,
      "sparse_tokens": 32025.0,
      "step": 2275,
      "turn_loss": 0.06659764796495438,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.10574242705816762,
      "grad_norm": 0.592711865901947,
      "learning_rate": 9.20983821444033e-06,
      "loss": 0.1435,
      "mae_dtheta": 0.038951724767684937,
      "mae_dx": 0.015476863831281662,
      "mae_dy": 0.006695844233036041,
      "pose_mae_dtheta": 0.2981612980365753,
      "pose_mae_dx": 0.11871971935033798,
      "pose_mae_dy": 0.09065259993076324,
      "pose_rmse_dtheta": 0.531042754650116,
      "pose_rmse_dx": 0.26305896043777466,
      "pose_rmse_dy": 0.2016262263059616,
      "pose_rmse_mean": 0.33190932869911194,
      "rmse_dtheta": 0.05737384408712387,
      "rmse_dx": 0.02937459759414196,
      "rmse_dy": 0.012123302556574345,
      "rmse_mean": 0.03295724838972092,
      "rotation_flip": 0.009049774147570133,
      "sparse_tokens": 22525.0,
      "step": 2276,
      "turn_loss": 0.31964629888534546,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.1057888868240104,
      "grad_norm": 0.5630806684494019,
      "learning_rate": 9.209124692976287e-06,
      "loss": 0.1491,
      "mae_dtheta": 0.01150641031563282,
      "mae_dx": 0.0024531399831175804,
      "mae_dy": 0.002103278646245599,
      "pose_mae_dtheta": 0.08875467628240585,
      "pose_mae_dx": 0.028368322178721428,
      "pose_mae_dy": 0.028700057417154312,
      "pose_rmse_dtheta": 0.2387670874595642,
      "pose_rmse_dx": 0.06335662305355072,
      "pose_rmse_dy": 0.07083671540021896,
      "pose_rmse_mean": 0.1243201494216919,
      "rmse_dtheta": 0.026555310934782028,
      "rmse_dx": 0.006435345858335495,
      "rmse_dy": 0.00467912619933486,
      "rmse_mean": 0.012556593865156174,
      "rotation_flip": 0.0036218762397766113,
      "sparse_tokens": 32233.0,
      "step": 2277,
      "turn_loss": 0.09227947145700455,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10583534658985319,
      "grad_norm": 0.7851439714431763,
      "learning_rate": 9.208410877165896e-06,
      "loss": 0.1252,
      "mae_dtheta": 0.009013528935611248,
      "mae_dx": 0.0017374362796545029,
      "mae_dy": 0.0013268397888168693,
      "pose_mae_dtheta": 0.06614527851343155,
      "pose_mae_dx": 0.0190108772367239,
      "pose_mae_dy": 0.023371851071715355,
      "pose_rmse_dtheta": 0.1529511660337448,
      "pose_rmse_dx": 0.04886092618107796,
      "pose_rmse_dy": 0.05744390934705734,
      "pose_rmse_mean": 0.08641867339611053,
      "rmse_dtheta": 0.020207583904266357,
      "rmse_dx": 0.005534474737942219,
      "rmse_dy": 0.002757995156571269,
      "rmse_mean": 0.009500017389655113,
      "rotation_flip": 0.004002001136541367,
      "sparse_tokens": 32121.0,
      "step": 2278,
      "turn_loss": 0.05767182633280754,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.10588180635569597,
      "grad_norm": 0.5062862634658813,
      "learning_rate": 9.207696767059074e-06,
      "loss": 0.1393,
      "mae_dtheta": 0.030584145337343216,
      "mae_dx": 0.011586116626858711,
      "mae_dy": 0.0042891185730695724,
      "pose_mae_dtheta": 0.2274036854505539,
      "pose_mae_dx": 0.08726809173822403,
      "pose_mae_dy": 0.05493810400366783,
      "pose_rmse_dtheta": 0.4144953787326813,
      "pose_rmse_dx": 0.19831515848636627,
      "pose_rmse_dy": 0.13304689526557922,
      "pose_rmse_mean": 0.2486191689968109,
      "rmse_dtheta": 0.048705391585826874,
      "rmse_dx": 0.023730305954813957,
      "rmse_dy": 0.007830655202269554,
      "rmse_mean": 0.026755452156066895,
      "rotation_flip": 0.010101010091602802,
      "sparse_tokens": 20949.0,
      "step": 2279,
      "turn_loss": 0.23895759880542755,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.10592826612153874,
      "grad_norm": 0.6884323954582214,
      "learning_rate": 9.206982362705758e-06,
      "loss": 0.1507,
      "mae_dtheta": 0.045478351414203644,
      "mae_dx": 0.011983462609350681,
      "mae_dy": 0.008277803659439087,
      "pose_mae_dtheta": 0.35946837067604065,
      "pose_mae_dx": 0.10405676811933517,
      "pose_mae_dy": 0.07895557582378387,
      "pose_rmse_dtheta": 0.5869031548500061,
      "pose_rmse_dx": 0.21054497361183167,
      "pose_rmse_dy": 0.2031009942293167,
      "pose_rmse_mean": 0.3335164189338684,
      "rmse_dtheta": 0.06418398022651672,
      "rmse_dx": 0.02233091928064823,
      "rmse_dy": 0.018157970160245895,
      "rmse_mean": 0.03489095717668533,
      "rotation_flip": 0.013245033100247383,
      "sparse_tokens": 13781.0,
      "step": 2280,
      "turn_loss": 0.3861682415008545,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.10597472588738152,
      "grad_norm": 0.45997315645217896,
      "learning_rate": 9.206267664155906e-06,
      "loss": 0.1188,
      "mae_dtheta": 0.00855822954326868,
      "mae_dx": 0.0013527346309274435,
      "mae_dy": 0.0013230608310550451,
      "pose_mae_dtheta": 0.06317637115716934,
      "pose_mae_dx": 0.01598765142261982,
      "pose_mae_dy": 0.024022193625569344,
      "pose_rmse_dtheta": 0.17897647619247437,
      "pose_rmse_dx": 0.04110436514019966,
      "pose_rmse_dy": 0.060265716165304184,
      "pose_rmse_mean": 0.09344884753227234,
      "rmse_dtheta": 0.022403735667467117,
      "rmse_dx": 0.004860613960772753,
      "rmse_dy": 0.0027728432323783636,
      "rmse_mean": 0.010012397542595863,
      "rotation_flip": 0.0032967033330351114,
      "sparse_tokens": 32057.0,
      "step": 2281,
      "turn_loss": 0.06796982884407043,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.10602118565322431,
      "grad_norm": 0.5084019899368286,
      "learning_rate": 9.205552671459501e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.03678429499268532,
      "mae_dx": 0.01626703515648842,
      "mae_dy": 0.006611746270209551,
      "pose_mae_dtheta": 0.30564284324645996,
      "pose_mae_dx": 0.13065487146377563,
      "pose_mae_dy": 0.08164811879396439,
      "pose_rmse_dtheta": 0.5222583413124084,
      "pose_rmse_dx": 0.2643760144710541,
      "pose_rmse_dy": 0.18382515013217926,
      "pose_rmse_mean": 0.3234865069389343,
      "rmse_dtheta": 0.054101064801216125,
      "rmse_dx": 0.028782416135072708,
      "rmse_dy": 0.012859555892646313,
      "rmse_mean": 0.03191434592008591,
      "rotation_flip": 0.007334963418543339,
      "sparse_tokens": 13350.0,
      "step": 2282,
      "turn_loss": 0.3213594853878021,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 30170.0,
      "epoch": 0.10606764541906709,
      "grad_norm": 0.4147924482822418,
      "learning_rate": 9.204837384666538e-06,
      "loss": 0.1496,
      "mae_dtheta": 0.03460092470049858,
      "mae_dx": 0.009528996422886848,
      "mae_dy": 0.0030406115110963583,
      "pose_mae_dtheta": 0.25951850414276123,
      "pose_mae_dx": 0.0750526636838913,
      "pose_mae_dy": 0.0288356002420187,
      "pose_rmse_dtheta": 0.47581565380096436,
      "pose_rmse_dx": 0.17383050918579102,
      "pose_rmse_dy": 0.06473838537931442,
      "pose_rmse_mean": 0.2381281852722168,
      "rmse_dtheta": 0.05383218079805374,
      "rmse_dx": 0.020423397421836853,
      "rmse_dy": 0.006350039504468441,
      "rmse_mean": 0.026868540793657303,
      "rotation_flip": 0.012587412260472775,
      "sparse_tokens": 25741.0,
      "step": 2283,
      "turn_loss": 0.2648102641105652,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.10611410518490987,
      "grad_norm": 0.6442222595214844,
      "learning_rate": 9.204121803827041e-06,
      "loss": 0.1563,
      "mae_dtheta": 0.010732409544289112,
      "mae_dx": 0.004246826749294996,
      "mae_dy": 0.001615474815480411,
      "pose_mae_dtheta": 0.07642558962106705,
      "pose_mae_dx": 0.03977318853139877,
      "pose_mae_dy": 0.021758437156677246,
      "pose_rmse_dtheta": 0.19669194519519806,
      "pose_rmse_dx": 0.11663584411144257,
      "pose_rmse_dy": 0.06151774898171425,
      "pose_rmse_mean": 0.12494851648807526,
      "rmse_dtheta": 0.02415083907544613,
      "rmse_dx": 0.012525210157036781,
      "rmse_dy": 0.004093723837286234,
      "rmse_mean": 0.01358992513269186,
      "rotation_flip": 0.005560704506933689,
      "sparse_tokens": 32169.0,
      "step": 2284,
      "turn_loss": 0.10046134144067764,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.10616056495075264,
      "grad_norm": 0.5110530257225037,
      "learning_rate": 9.20340592899105e-06,
      "loss": 0.1141,
      "mae_dtheta": 0.014017901383340359,
      "mae_dx": 0.0015974778216332197,
      "mae_dy": 0.002580611500889063,
      "pose_mae_dtheta": 0.09933686256408691,
      "pose_mae_dx": 0.02764982171356678,
      "pose_mae_dy": 0.03966444730758667,
      "pose_rmse_dtheta": 0.20095856487751007,
      "pose_rmse_dx": 0.06902410835027695,
      "pose_rmse_dy": 0.08679347485303879,
      "pose_rmse_mean": 0.11892538517713547,
      "rmse_dtheta": 0.025152431800961494,
      "rmse_dx": 0.005580951925367117,
      "rmse_dy": 0.005009068176150322,
      "rmse_mean": 0.011914151720702648,
      "rotation_flip": 0.002502681454643607,
      "sparse_tokens": 32057.0,
      "step": 2285,
      "turn_loss": 0.08889801055192947,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17537.0,
      "epoch": 0.10620702471659543,
      "grad_norm": 0.3896559774875641,
      "learning_rate": 9.202689760208627e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.03996075689792633,
      "mae_dx": 0.014787026681005955,
      "mae_dy": 0.004053720738738775,
      "pose_mae_dtheta": 0.3035079836845398,
      "pose_mae_dx": 0.12650690972805023,
      "pose_mae_dy": 0.043265022337436676,
      "pose_rmse_dtheta": 0.4886600077152252,
      "pose_rmse_dx": 0.2643016278743744,
      "pose_rmse_dy": 0.10212383419275284,
      "pose_rmse_mean": 0.28502851724624634,
      "rmse_dtheta": 0.0560699962079525,
      "rmse_dx": 0.028062917292118073,
      "rmse_dy": 0.008028609678149223,
      "rmse_mean": 0.030720507726073265,
      "rotation_flip": 0.02283105067908764,
      "sparse_tokens": 12934.0,
      "step": 2286,
      "turn_loss": 0.3032246232032776,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10625348448243821,
      "grad_norm": 0.6732617616653442,
      "learning_rate": 9.201973297529852e-06,
      "loss": 0.1491,
      "mae_dtheta": 0.007549003232270479,
      "mae_dx": 0.0013393290573731065,
      "mae_dy": 0.001098227920010686,
      "pose_mae_dtheta": 0.0551251545548439,
      "pose_mae_dx": 0.01482147816568613,
      "pose_mae_dy": 0.016492431983351707,
      "pose_rmse_dtheta": 0.1785738319158554,
      "pose_rmse_dx": 0.03500157222151756,
      "pose_rmse_dy": 0.03917008265852928,
      "pose_rmse_mean": 0.08424849808216095,
      "rmse_dtheta": 0.021524745970964432,
      "rmse_dx": 0.0038825811352580786,
      "rmse_dy": 0.002483088755980134,
      "rmse_mean": 0.00929680559784174,
      "rotation_flip": 0.0014829460997134447,
      "sparse_tokens": 32121.0,
      "step": 2287,
      "turn_loss": 0.05051374062895775,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.10629994424828099,
      "grad_norm": 0.5529928803443909,
      "learning_rate": 9.20125654100483e-06,
      "loss": 0.2174,
      "mae_dtheta": 0.026630204170942307,
      "mae_dx": 0.011051617562770844,
      "mae_dy": 0.006525170523673296,
      "pose_mae_dtheta": 0.21234765648841858,
      "pose_mae_dx": 0.0854470506310463,
      "pose_mae_dy": 0.0729793831706047,
      "pose_rmse_dtheta": 0.39216363430023193,
      "pose_rmse_dx": 0.2094234824180603,
      "pose_rmse_dy": 0.17388367652893066,
      "pose_rmse_mean": 0.25849026441574097,
      "rmse_dtheta": 0.04453997313976288,
      "rmse_dx": 0.02452629990875721,
      "rmse_dy": 0.015900103375315666,
      "rmse_mean": 0.02832212671637535,
      "rotation_flip": 0.012513034045696259,
      "sparse_tokens": 19211.0,
      "step": 2288,
      "turn_loss": 0.24165883660316467,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10634640401412376,
      "grad_norm": 0.31977152824401855,
      "learning_rate": 9.200539490683682e-06,
      "loss": 0.113,
      "mae_dtheta": 0.012377827428281307,
      "mae_dx": 0.0025615610647946596,
      "mae_dy": 0.0029806948732584715,
      "pose_mae_dtheta": 0.08856499940156937,
      "pose_mae_dx": 0.02991051971912384,
      "pose_mae_dy": 0.03423744812607765,
      "pose_rmse_dtheta": 0.1907225102186203,
      "pose_rmse_dx": 0.08315934985876083,
      "pose_rmse_dy": 0.08233390003442764,
      "pose_rmse_mean": 0.1187385842204094,
      "rmse_dtheta": 0.025239767506718636,
      "rmse_dx": 0.008031933568418026,
      "rmse_dy": 0.007285097148269415,
      "rmse_mean": 0.013518932275474072,
      "rotation_flip": 0.004776378627866507,
      "sparse_tokens": 32105.0,
      "step": 2289,
      "turn_loss": 0.11614948511123657,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.10639286377996655,
      "grad_norm": 0.6226519346237183,
      "learning_rate": 9.199822146616553e-06,
      "loss": 0.1122,
      "mae_dtheta": 0.013546830974519253,
      "mae_dx": 0.002700930228456855,
      "mae_dy": 0.0038643316365778446,
      "pose_mae_dtheta": 0.0935448631644249,
      "pose_mae_dx": 0.03716756030917168,
      "pose_mae_dy": 0.04714338481426239,
      "pose_rmse_dtheta": 0.19076663255691528,
      "pose_rmse_dx": 0.08936532586812973,
      "pose_rmse_dy": 0.1284942924976349,
      "pose_rmse_mean": 0.13620875775814056,
      "rmse_dtheta": 0.024669332429766655,
      "rmse_dx": 0.007319897413253784,
      "rmse_dy": 0.008160806261003017,
      "rmse_mean": 0.013383346609771252,
      "rotation_flip": 0.005801305174827576,
      "sparse_tokens": 32073.0,
      "step": 2290,
      "turn_loss": 0.1234552189707756,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.10643932354580933,
      "grad_norm": 0.39992618560791016,
      "learning_rate": 9.199104508853607e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.011179624125361443,
      "mae_dx": 0.0024158318992704153,
      "mae_dy": 0.0025839172303676605,
      "pose_mae_dtheta": 0.07953251898288727,
      "pose_mae_dx": 0.0239871796220541,
      "pose_mae_dy": 0.02656838856637478,
      "pose_rmse_dtheta": 0.220506489276886,
      "pose_rmse_dx": 0.06361567974090576,
      "pose_rmse_dy": 0.0620771124958992,
      "pose_rmse_mean": 0.11539976298809052,
      "rmse_dtheta": 0.026544949039816856,
      "rmse_dx": 0.007419542875140905,
      "rmse_dy": 0.006550180725753307,
      "rmse_mean": 0.013504891656339169,
      "rotation_flip": 0.002527379896491766,
      "sparse_tokens": 32153.0,
      "step": 2291,
      "turn_loss": 0.10142214596271515,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10648578331165211,
      "grad_norm": 0.37282297015190125,
      "learning_rate": 9.19838657744503e-06,
      "loss": 0.0995,
      "mae_dtheta": 0.013776042498648167,
      "mae_dx": 0.002537309657782316,
      "mae_dy": 0.0032428239937871695,
      "pose_mae_dtheta": 0.09595862030982971,
      "pose_mae_dx": 0.031523026525974274,
      "pose_mae_dy": 0.03677252680063248,
      "pose_rmse_dtheta": 0.21588513255119324,
      "pose_rmse_dx": 0.07091446965932846,
      "pose_rmse_dy": 0.08175770193338394,
      "pose_rmse_mean": 0.12285243719816208,
      "rmse_dtheta": 0.026854459196329117,
      "rmse_dx": 0.006994256749749184,
      "rmse_dy": 0.0069314781576395035,
      "rmse_mean": 0.013593398034572601,
      "rotation_flip": 0.0051299589686095715,
      "sparse_tokens": 32105.0,
      "step": 2292,
      "turn_loss": 0.12332215905189514,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.10653224307749488,
      "grad_norm": 0.40374302864074707,
      "learning_rate": 9.197668352441025e-06,
      "loss": 0.109,
      "mae_dtheta": 0.011190954595804214,
      "mae_dx": 0.0026434913743287325,
      "mae_dy": 0.0014409145805984735,
      "pose_mae_dtheta": 0.0857909619808197,
      "pose_mae_dx": 0.022056207060813904,
      "pose_mae_dy": 0.017489353194832802,
      "pose_rmse_dtheta": 0.2631528973579407,
      "pose_rmse_dx": 0.0872555524110794,
      "pose_rmse_dy": 0.05258842930197716,
      "pose_rmse_mean": 0.1343322992324829,
      "rmse_dtheta": 0.02947661466896534,
      "rmse_dx": 0.008872725069522858,
      "rmse_dy": 0.005104974377900362,
      "rmse_mean": 0.014484770596027374,
      "rotation_flip": 0.005300353281199932,
      "sparse_tokens": 32153.0,
      "step": 2293,
      "turn_loss": 0.0737793818116188,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29432.0,
      "epoch": 0.10657870284333767,
      "grad_norm": 0.6371296644210815,
      "learning_rate": 9.19694983389182e-06,
      "loss": 0.1995,
      "mae_dtheta": 0.042739856988191605,
      "mae_dx": 0.016597585752606392,
      "mae_dy": 0.005950676277279854,
      "pose_mae_dtheta": 0.3474222421646118,
      "pose_mae_dx": 0.13809587061405182,
      "pose_mae_dy": 0.06861806660890579,
      "pose_rmse_dtheta": 0.56108158826828,
      "pose_rmse_dx": 0.2849791944026947,
      "pose_rmse_dy": 0.16096550226211548,
      "pose_rmse_mean": 0.3356754183769226,
      "rmse_dtheta": 0.061980511993169785,
      "rmse_dx": 0.029954755678772926,
      "rmse_dy": 0.012258226051926613,
      "rmse_mean": 0.03473116457462311,
      "rotation_flip": 0.01997245103120804,
      "sparse_tokens": 22764.0,
      "step": 2294,
      "turn_loss": 0.3519802391529083,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.10662516260918045,
      "grad_norm": 0.6566016674041748,
      "learning_rate": 9.19623102184766e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.03383605182170868,
      "mae_dx": 0.011865129694342613,
      "mae_dy": 0.008125373162329197,
      "pose_mae_dtheta": 0.3017639219760895,
      "pose_mae_dx": 0.10129380971193314,
      "pose_mae_dy": 0.09073923528194427,
      "pose_rmse_dtheta": 0.5508475303649902,
      "pose_rmse_dx": 0.24212077260017395,
      "pose_rmse_dy": 0.2252287119626999,
      "pose_rmse_mean": 0.33939898014068604,
      "rmse_dtheta": 0.05651957169175148,
      "rmse_dx": 0.024832509458065033,
      "rmse_dy": 0.01970161311328411,
      "rmse_mean": 0.033684566617012024,
      "rotation_flip": 0.005347593687474728,
      "sparse_tokens": 8159.0,
      "step": 2295,
      "turn_loss": 0.3472811281681061,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.10667162237502323,
      "grad_norm": 0.6488782167434692,
      "learning_rate": 9.195511916358813e-06,
      "loss": 0.175,
      "mae_dtheta": 0.03410320729017258,
      "mae_dx": 0.010781843215227127,
      "mae_dy": 0.00449431873857975,
      "pose_mae_dtheta": 0.2633240520954132,
      "pose_mae_dx": 0.0791349932551384,
      "pose_mae_dy": 0.05582806095480919,
      "pose_rmse_dtheta": 0.46836817264556885,
      "pose_rmse_dx": 0.17903389036655426,
      "pose_rmse_dy": 0.10734162479639053,
      "pose_rmse_mean": 0.25158125162124634,
      "rmse_dtheta": 0.05073629692196846,
      "rmse_dx": 0.022154493257403374,
      "rmse_dy": 0.007934585213661194,
      "rmse_mean": 0.02694179117679596,
      "rotation_flip": 0.01272727269679308,
      "sparse_tokens": 18195.0,
      "step": 2296,
      "turn_loss": 0.2669799029827118,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.106718082140866,
      "grad_norm": 0.5264620184898376,
      "learning_rate": 9.194792517475565e-06,
      "loss": 0.1671,
      "mae_dtheta": 0.02795495092868805,
      "mae_dx": 0.01186192873865366,
      "mae_dy": 0.0036059971898794174,
      "pose_mae_dtheta": 0.19799865782260895,
      "pose_mae_dx": 0.09029495716094971,
      "pose_mae_dy": 0.05471888184547424,
      "pose_rmse_dtheta": 0.3647637367248535,
      "pose_rmse_dx": 0.22552156448364258,
      "pose_rmse_dy": 0.14231933653354645,
      "pose_rmse_mean": 0.24420154094696045,
      "rmse_dtheta": 0.04467221349477768,
      "rmse_dx": 0.02567816711962223,
      "rmse_dy": 0.006719575729221106,
      "rmse_mean": 0.0256899856030941,
      "rotation_flip": 0.012711863964796066,
      "sparse_tokens": 7474.0,
      "step": 2297,
      "turn_loss": 0.28248512744903564,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1067645419067088,
      "grad_norm": 0.45752960443496704,
      "learning_rate": 9.194072825248224e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.008935000747442245,
      "mae_dx": 0.0019140949007123709,
      "mae_dy": 0.0019069346599280834,
      "pose_mae_dtheta": 0.06304459273815155,
      "pose_mae_dx": 0.022406810894608498,
      "pose_mae_dy": 0.024584602564573288,
      "pose_rmse_dtheta": 0.1478481888771057,
      "pose_rmse_dx": 0.06265902519226074,
      "pose_rmse_dy": 0.05644609406590462,
      "pose_rmse_mean": 0.08898444473743439,
      "rmse_dtheta": 0.019885018467903137,
      "rmse_dx": 0.005810174159705639,
      "rmse_dy": 0.005263055674731731,
      "rmse_mean": 0.010319417342543602,
      "rotation_flip": 0.002324680332094431,
      "sparse_tokens": 32137.0,
      "step": 2298,
      "turn_loss": 0.06458863615989685,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.10681100167255157,
      "grad_norm": 0.5374558568000793,
      "learning_rate": 9.193352839727122e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.03666732832789421,
      "mae_dx": 0.010579708032310009,
      "mae_dy": 0.007794974371790886,
      "pose_mae_dtheta": 0.29853349924087524,
      "pose_mae_dx": 0.08071132749319077,
      "pose_mae_dy": 0.06591692566871643,
      "pose_rmse_dtheta": 0.5279422998428345,
      "pose_rmse_dx": 0.17938831448554993,
      "pose_rmse_dy": 0.15140308439731598,
      "pose_rmse_mean": 0.28624457120895386,
      "rmse_dtheta": 0.05665389448404312,
      "rmse_dx": 0.020913898944854736,
      "rmse_dy": 0.016144920140504837,
      "rmse_mean": 0.03123757243156433,
      "rotation_flip": 0.01840490847826004,
      "sparse_tokens": 7786.0,
      "step": 2299,
      "turn_loss": 0.2792064845561981,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 31791.0,
      "epoch": 0.10685746143839435,
      "grad_norm": 0.7720853090286255,
      "learning_rate": 9.192632560962602e-06,
      "loss": 0.1657,
      "mae_dtheta": 0.03148891031742096,
      "mae_dx": 0.009835759177803993,
      "mae_dy": 0.004661162383854389,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7720852494239807,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.25579833984375,
      "model/head/act_norm_mean": 108.57274394132654,
      "model/head/act_norm_min": 61.99430847167969,
      "model/head/act_over_embed": 74.61220611052319,
      "model/head/grad_frac": 0.08945587277412415,
      "model/head/grad_norm": 0.0690675601363182,
      "model/head/grad_zero_frac": 0.00018719033687375486,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6837432238520408,
      "model/head/update_ratio": 0.0011961424024775624,
      "model/head/weight_delta": 5.511861324310303,
      "model/head/weight_delta_rel": 0.09669437259435654,
      "model/head/weight_norm": 57.741920471191406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41468143463134766,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4146145907315341,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4145553708076477,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2849270284336656,
      "model/modality_embedder.encoders.pose/grad_frac": 0.14693665504455566,
      "model/modality_embedder.encoders.pose/grad_norm": 0.11344762146472931,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5349589646464646,
      "model/modality_embedder.encoders.pose/update_ratio": 0.003686287673190236,
      "model/modality_embedder.encoders.pose/weight_delta": 1.795079231262207,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05865083262324333,
      "model/modality_embedder.encoders.pose/weight_norm": 30.77557373046875,
      "model/modality_embedder/grad_frac": 0.14693665504455566,
      "model/modality_embedder/grad_norm": 0.11344762146472931,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5349589646464646,
      "model/modality_embedder/update_ratio": 0.003686287673190236,
      "model/modality_embedder/weight_delta": 1.795079231262207,
      "model/modality_embedder/weight_delta_rel": 0.05865083262324333,
      "model/modality_embedder/weight_norm": 30.77557373046875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.34064483642578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.3249716553288,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.998871803283691,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.029138893367094,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0819665715098381,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06328517943620682,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002290776465088129,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.1285651922225952,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.041125595569610596,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.626083374023438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.7255630493164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.23623005749919,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.34318733215332,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.655364198674157,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07432392239570618,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05738440528512001,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001964987488463521,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.4138078689575195,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.04897540807723999,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.203445434570312,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.648193359375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.95097384191772,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.305171966552734,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.833752181010812,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08450648188591003,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06524620950222015,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0021647156681865454,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.5093557834625244,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05068134143948555,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.140775680541992,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.49113464355469,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.89820466877227,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.370725631713867,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.171907435487483,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08882749825716019,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06858240067958832,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0023232668172568083,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.286926507949829,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.04398104175925255,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.519811630249023,
      "model/normalizer/grad_frac": 0.31445562839508057,
      "model/normalizer/grad_norm": 0.24278655648231506,
      "model/normalizer/grad_zero_frac": 0.00018671466386877,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0031118441838771105,
      "model/normalizer/weight_delta": 2.7490625381469727,
      "model/normalizer/weight_delta_rel": 0.03540633246302605,
      "model/normalizer/weight_norm": 78.02014923095703,
      "pose_mae_dtheta": 0.23701442778110504,
      "pose_mae_dx": 0.07869698107242584,
      "pose_mae_dy": 0.055962253361940384,
      "pose_rmse_dtheta": 0.4455517530441284,
      "pose_rmse_dx": 0.18000149726867676,
      "pose_rmse_dy": 0.1377159059047699,
      "pose_rmse_mean": 0.2544230818748474,
      "rmse_dtheta": 0.04895675554871559,
      "rmse_dx": 0.020730936899781227,
      "rmse_dy": 0.009205291047692299,
      "rmse_mean": 0.026297662407159805,
      "rotation_flip": 0.012211669236421585,
      "sparse_tokens": 25890.0,
      "step": 2300,
      "turn_loss": 0.2540992498397827,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64148.0,
      "epoch": 0.10690392120423713,
      "grad_norm": 0.5910991430282593,
      "learning_rate": 9.191911989005038e-06,
      "loss": 0.1573,
      "mae_dtheta": 0.009005759842693806,
      "mae_dx": 0.002028714632615447,
      "mae_dy": 0.002470789011567831,
      "pose_mae_dtheta": 0.05847056955099106,
      "pose_mae_dx": 0.0222163088619709,
      "pose_mae_dy": 0.029103770852088928,
      "pose_rmse_dtheta": 0.12671294808387756,
      "pose_rmse_dx": 0.060624852776527405,
      "pose_rmse_dy": 0.07473298162221909,
      "pose_rmse_mean": 0.08735692501068115,
      "rmse_dtheta": 0.0196464192122221,
      "rmse_dx": 0.006413960363715887,
      "rmse_dy": 0.0058297524228692055,
      "rmse_mean": 0.010630044154822826,
      "rotation_flip": 0.004826678428798914,
      "sparse_tokens": 32048.0,
      "step": 2301,
      "turn_loss": 0.07977967709302902,
      "turns": 197.0,
      "turns_per_sample": 197.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.10695038097007992,
      "grad_norm": 0.5200318098068237,
      "learning_rate": 9.19119112390482e-06,
      "loss": 0.1533,
      "mae_dtheta": 0.03642020747065544,
      "mae_dx": 0.012658807449042797,
      "mae_dy": 0.004628356546163559,
      "pose_mae_dtheta": 0.29214033484458923,
      "pose_mae_dx": 0.09349088370800018,
      "pose_mae_dy": 0.057701658457517624,
      "pose_rmse_dtheta": 0.48797157406806946,
      "pose_rmse_dx": 0.22503112256526947,
      "pose_rmse_dy": 0.1256588250398636,
      "pose_rmse_mean": 0.2795538306236267,
      "rmse_dtheta": 0.053042009472846985,
      "rmse_dx": 0.024945173412561417,
      "rmse_dy": 0.008698116056621075,
      "rmse_mean": 0.028895098716020584,
      "rotation_flip": 0.010020039975643158,
      "sparse_tokens": 8491.0,
      "step": 2302,
      "turn_loss": 0.2867666482925415,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1069968407359227,
      "grad_norm": 0.6098635792732239,
      "learning_rate": 9.190469965712356e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.014203705824911594,
      "mae_dx": 0.0026357469614595175,
      "mae_dy": 0.0019255337538197637,
      "pose_mae_dtheta": 0.10493816435337067,
      "pose_mae_dx": 0.02329377830028534,
      "pose_mae_dy": 0.020269861444830894,
      "pose_rmse_dtheta": 0.2856113016605377,
      "pose_rmse_dx": 0.05967970937490463,
      "pose_rmse_dy": 0.047340091317892075,
      "pose_rmse_mean": 0.1308770477771759,
      "rmse_dtheta": 0.0330643355846405,
      "rmse_dx": 0.00802672654390335,
      "rmse_dy": 0.005433510988950729,
      "rmse_mean": 0.015508191660046577,
      "rotation_flip": 0.0029325513169169426,
      "sparse_tokens": 32169.0,
      "step": 2303,
      "turn_loss": 0.11370708793401718,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.10704330050176547,
      "grad_norm": 0.5230410099029541,
      "learning_rate": 9.189748514478077e-06,
      "loss": 0.1408,
      "mae_dtheta": 0.03613827005028725,
      "mae_dx": 0.015138434246182442,
      "mae_dy": 0.004739651456475258,
      "pose_mae_dtheta": 0.3090934157371521,
      "pose_mae_dx": 0.11861437559127808,
      "pose_mae_dy": 0.06639312952756882,
      "pose_rmse_dtheta": 0.519664466381073,
      "pose_rmse_dx": 0.26644182205200195,
      "pose_rmse_dy": 0.14986687898635864,
      "pose_rmse_mean": 0.3119910657405853,
      "rmse_dtheta": 0.053266800940036774,
      "rmse_dx": 0.029054423794150352,
      "rmse_dy": 0.009960518218576908,
      "rmse_mean": 0.03076058253645897,
      "rotation_flip": 0.016410255804657936,
      "sparse_tokens": 15134.0,
      "step": 2304,
      "turn_loss": 0.28899016976356506,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.10708976026760825,
      "grad_norm": 1.1642837524414062,
      "learning_rate": 9.189026770252437e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.00888743530958891,
      "mae_dx": 0.0014048044104129076,
      "mae_dy": 0.0015188549878075719,
      "pose_mae_dtheta": 0.07009107619524002,
      "pose_mae_dx": 0.015061070211231709,
      "pose_mae_dy": 0.023556193336844444,
      "pose_rmse_dtheta": 0.19759218394756317,
      "pose_rmse_dx": 0.03961686044931412,
      "pose_rmse_dy": 0.060836028307676315,
      "pose_rmse_mean": 0.09934835880994797,
      "rmse_dtheta": 0.02300279214978218,
      "rmse_dx": 0.005101258400827646,
      "rmse_dy": 0.0037035939749330282,
      "rmse_mean": 0.010602547787129879,
      "rotation_flip": 0.0025265284348279238,
      "sparse_tokens": 32073.0,
      "step": 2305,
      "turn_loss": 0.0631091445684433,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.10713622003345104,
      "grad_norm": 0.9790669679641724,
      "learning_rate": 9.188304733085907e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.009774311445653439,
      "mae_dx": 0.0027074285317212343,
      "mae_dy": 0.001381949638016522,
      "pose_mae_dtheta": 0.07334733754396439,
      "pose_mae_dx": 0.02743721939623356,
      "pose_mae_dy": 0.01709475927054882,
      "pose_rmse_dtheta": 0.21058279275894165,
      "pose_rmse_dx": 0.08463604748249054,
      "pose_rmse_dy": 0.0475318543612957,
      "pose_rmse_mean": 0.11425022780895233,
      "rmse_dtheta": 0.02504800260066986,
      "rmse_dx": 0.00726051302626729,
      "rmse_dy": 0.00434351060539484,
      "rmse_mean": 0.012217341922223568,
      "rotation_flip": 0.007710843347012997,
      "sparse_tokens": 32185.0,
      "step": 2306,
      "turn_loss": 0.08428362011909485,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10718267979929381,
      "grad_norm": 0.716521143913269,
      "learning_rate": 9.187582403028978e-06,
      "loss": 0.1582,
      "mae_dtheta": 0.010835757479071617,
      "mae_dx": 0.0023062664549797773,
      "mae_dy": 0.0026349567342549562,
      "pose_mae_dtheta": 0.07507410645484924,
      "pose_mae_dx": 0.02742656320333481,
      "pose_mae_dy": 0.03165402635931969,
      "pose_rmse_dtheta": 0.1748412400484085,
      "pose_rmse_dx": 0.06742919981479645,
      "pose_rmse_dy": 0.07256721705198288,
      "pose_rmse_mean": 0.10494589060544968,
      "rmse_dtheta": 0.02460402622818947,
      "rmse_dx": 0.006944442167878151,
      "rmse_dy": 0.006578754633665085,
      "rmse_mean": 0.012709075585007668,
      "rotation_flip": 0.012809187173843384,
      "sparse_tokens": 32089.0,
      "step": 2307,
      "turn_loss": 0.09035201370716095,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.10722913956513659,
      "grad_norm": 0.9043292999267578,
      "learning_rate": 9.186859780132165e-06,
      "loss": 0.3014,
      "mae_dtheta": 0.04162302613258362,
      "mae_dx": 0.01479018572717905,
      "mae_dy": 0.006855673622339964,
      "pose_mae_dtheta": 0.3400079905986786,
      "pose_mae_dx": 0.10899107158184052,
      "pose_mae_dy": 0.10325831919908524,
      "pose_rmse_dtheta": 0.5551380515098572,
      "pose_rmse_dx": 0.21927456557750702,
      "pose_rmse_dy": 0.22231462597846985,
      "pose_rmse_mean": 0.3322424292564392,
      "rmse_dtheta": 0.059292469173669815,
      "rmse_dx": 0.02765490859746933,
      "rmse_dy": 0.01175620872527361,
      "rmse_mean": 0.03290119767189026,
      "rotation_flip": 0.015539305284619331,
      "sparse_tokens": 18727.0,
      "step": 2308,
      "turn_loss": 0.31306684017181396,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.10727559933097937,
      "grad_norm": 0.9507883191108704,
      "learning_rate": 9.186136864445998e-06,
      "loss": 0.2925,
      "mae_dtheta": 0.02300361916422844,
      "mae_dx": 0.009727640077471733,
      "mae_dy": 0.002953384770080447,
      "pose_mae_dtheta": 0.19340600073337555,
      "pose_mae_dx": 0.076882004737854,
      "pose_mae_dy": 0.04647441580891609,
      "pose_rmse_dtheta": 0.39144662022590637,
      "pose_rmse_dx": 0.17996715009212494,
      "pose_rmse_dy": 0.10639660060405731,
      "pose_rmse_mean": 0.22593680024147034,
      "rmse_dtheta": 0.03984620422124863,
      "rmse_dx": 0.02161935344338417,
      "rmse_dy": 0.005383370444178581,
      "rmse_mean": 0.022282976657152176,
      "rotation_flip": 0.008086252957582474,
      "sparse_tokens": 7145.0,
      "step": 2309,
      "turn_loss": 0.18775449693202972,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10732205909682216,
      "grad_norm": 0.7746633291244507,
      "learning_rate": 9.185413656021037e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.009449111297726631,
      "mae_dx": 0.0018488740315660834,
      "mae_dy": 0.0024190449621528387,
      "pose_mae_dtheta": 0.06173767149448395,
      "pose_mae_dx": 0.023862609639763832,
      "pose_mae_dy": 0.029037877917289734,
      "pose_rmse_dtheta": 0.11938704550266266,
      "pose_rmse_dx": 0.05606872960925102,
      "pose_rmse_dy": 0.06792251765727997,
      "pose_rmse_mean": 0.08112610131502151,
      "rmse_dtheta": 0.018915677443146706,
      "rmse_dx": 0.004968044348061085,
      "rmse_dy": 0.0057382467202842236,
      "rmse_mean": 0.009873989969491959,
      "rotation_flip": 0.0057142856530845165,
      "sparse_tokens": 32105.0,
      "step": 2310,
      "turn_loss": 0.0878634825348854,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10736851886266494,
      "grad_norm": 0.7264811396598816,
      "learning_rate": 9.18469015490785e-06,
      "loss": 0.1308,
      "mae_dtheta": 0.0133934635668993,
      "mae_dx": 0.0021087091881781816,
      "mae_dy": 0.0033815205097198486,
      "pose_mae_dtheta": 0.0905250832438469,
      "pose_mae_dx": 0.03387440741062164,
      "pose_mae_dy": 0.04310985282063484,
      "pose_rmse_dtheta": 0.16972912847995758,
      "pose_rmse_dx": 0.08632953464984894,
      "pose_rmse_dy": 0.10764932632446289,
      "pose_rmse_mean": 0.12123599648475647,
      "rmse_dtheta": 0.022740719839930534,
      "rmse_dx": 0.006018710322678089,
      "rmse_dy": 0.006960656493902206,
      "rmse_mean": 0.011906696483492851,
      "rotation_flip": 0.005627275910228491,
      "sparse_tokens": 32089.0,
      "step": 2311,
      "turn_loss": 0.10315488278865814,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.10741497862850771,
      "grad_norm": 0.8080946803092957,
      "learning_rate": 9.183966361157033e-06,
      "loss": 0.1981,
      "mae_dtheta": 0.026540638878941536,
      "mae_dx": 0.0076680853962898254,
      "mae_dy": 0.003911023028194904,
      "pose_mae_dtheta": 0.1842317134141922,
      "pose_mae_dx": 0.06536004692316055,
      "pose_mae_dy": 0.043054044246673584,
      "pose_rmse_dtheta": 0.281962126493454,
      "pose_rmse_dx": 0.1593368500471115,
      "pose_rmse_dy": 0.09020218998193741,
      "pose_rmse_mean": 0.17716705799102783,
      "rmse_dtheta": 0.0390046089887619,
      "rmse_dx": 0.018635887652635574,
      "rmse_dy": 0.0062351892702281475,
      "rmse_mean": 0.02129189483821392,
      "rotation_flip": 0.0031645570416003466,
      "sparse_tokens": 6194.0,
      "step": 2312,
      "turn_loss": 0.2074791043996811,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.10746143839435049,
      "grad_norm": 0.5951972007751465,
      "learning_rate": 9.183242274819205e-06,
      "loss": 0.1626,
      "mae_dtheta": 0.012466135434806347,
      "mae_dx": 0.0019263671711087227,
      "mae_dy": 0.003141409019008279,
      "pose_mae_dtheta": 0.08551400899887085,
      "pose_mae_dx": 0.02614171989262104,
      "pose_mae_dy": 0.03787955269217491,
      "pose_rmse_dtheta": 0.19181577861309052,
      "pose_rmse_dx": 0.06894876807928085,
      "pose_rmse_dy": 0.08120957016944885,
      "pose_rmse_mean": 0.11399137228727341,
      "rmse_dtheta": 0.024378448724746704,
      "rmse_dx": 0.005686732474714518,
      "rmse_dy": 0.006843207404017448,
      "rmse_mean": 0.012302796356379986,
      "rotation_flip": 0.0045265937224030495,
      "sparse_tokens": 32057.0,
      "step": 2313,
      "turn_loss": 0.10649484395980835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10750789816019327,
      "grad_norm": 0.5860717296600342,
      "learning_rate": 9.182517895945e-06,
      "loss": 0.1053,
      "mae_dtheta": 0.012552812695503235,
      "mae_dx": 0.0023456616327166557,
      "mae_dy": 0.003362115938216448,
      "pose_mae_dtheta": 0.08854071795940399,
      "pose_mae_dx": 0.028416408225893974,
      "pose_mae_dy": 0.03939720615744591,
      "pose_rmse_dtheta": 0.173611581325531,
      "pose_rmse_dx": 0.07303199917078018,
      "pose_rmse_dy": 0.09234008938074112,
      "pose_rmse_mean": 0.11299455165863037,
      "rmse_dtheta": 0.02378161996603012,
      "rmse_dx": 0.007001202087849379,
      "rmse_dy": 0.007567223627120256,
      "rmse_mean": 0.012783348560333252,
      "rotation_flip": 0.012233484536409378,
      "sparse_tokens": 32121.0,
      "step": 2314,
      "turn_loss": 0.10945819318294525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.10755435792603606,
      "grad_norm": 0.564944863319397,
      "learning_rate": 9.181793224585072e-06,
      "loss": 0.107,
      "mae_dtheta": 0.014272572472691536,
      "mae_dx": 0.004307774361222982,
      "mae_dy": 0.004801567643880844,
      "pose_mae_dtheta": 0.09593293070793152,
      "pose_mae_dx": 0.04911324754357338,
      "pose_mae_dy": 0.04332269728183746,
      "pose_rmse_dtheta": 0.19728949666023254,
      "pose_rmse_dx": 0.12176425009965897,
      "pose_rmse_dy": 0.10524015128612518,
      "pose_rmse_mean": 0.1414313018321991,
      "rmse_dtheta": 0.026005471125245094,
      "rmse_dx": 0.01107446476817131,
      "rmse_dy": 0.011499157175421715,
      "rmse_mean": 0.016193032264709473,
      "rotation_flip": 0.0030695770401507616,
      "sparse_tokens": 32121.0,
      "step": 2315,
      "turn_loss": 0.14093008637428284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10760081769187883,
      "grad_norm": 0.46284255385398865,
      "learning_rate": 9.181068260790101e-06,
      "loss": 0.1333,
      "mae_dtheta": 0.012623636983335018,
      "mae_dx": 0.0025053592398762703,
      "mae_dy": 0.003454189980402589,
      "pose_mae_dtheta": 0.08482039719820023,
      "pose_mae_dx": 0.033136069774627686,
      "pose_mae_dy": 0.035292189568281174,
      "pose_rmse_dtheta": 0.16935184597969055,
      "pose_rmse_dx": 0.08194520324468613,
      "pose_rmse_dy": 0.07497896999120712,
      "pose_rmse_mean": 0.10875868052244186,
      "rmse_dtheta": 0.025432920083403587,
      "rmse_dx": 0.007260856218636036,
      "rmse_dy": 0.007743801921606064,
      "rmse_mean": 0.013479193672537804,
      "rotation_flip": 0.005967006087303162,
      "sparse_tokens": 32105.0,
      "step": 2316,
      "turn_loss": 0.1086864247918129,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.10764727745772161,
      "grad_norm": 0.5284841656684875,
      "learning_rate": 9.18034300461078e-06,
      "loss": 0.1052,
      "mae_dtheta": 0.02945360168814659,
      "mae_dx": 0.008923106826841831,
      "mae_dy": 0.003969825338572264,
      "pose_mae_dtheta": 0.2285984307527542,
      "pose_mae_dx": 0.08053215593099594,
      "pose_mae_dy": 0.05825398862361908,
      "pose_rmse_dtheta": 0.4075853228569031,
      "pose_rmse_dx": 0.19427023828029633,
      "pose_rmse_dy": 0.11565140634775162,
      "pose_rmse_mean": 0.23916900157928467,
      "rmse_dtheta": 0.04693278297781944,
      "rmse_dx": 0.020472073927521706,
      "rmse_dy": 0.006822623778134584,
      "rmse_mean": 0.024742495268583298,
      "rotation_flip": 0.015602837316691875,
      "sparse_tokens": 14714.0,
      "step": 2317,
      "turn_loss": 0.22585487365722656,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10769373722356439,
      "grad_norm": 0.37668895721435547,
      "learning_rate": 9.17961745609783e-06,
      "loss": 0.0956,
      "mae_dtheta": 0.01259087584912777,
      "mae_dx": 0.001901900046505034,
      "mae_dy": 0.0017848373390734196,
      "pose_mae_dtheta": 0.09025350213050842,
      "pose_mae_dx": 0.0230434350669384,
      "pose_mae_dy": 0.02531013824045658,
      "pose_rmse_dtheta": 0.251788854598999,
      "pose_rmse_dx": 0.06751630455255508,
      "pose_rmse_dy": 0.055593959987163544,
      "pose_rmse_mean": 0.12496637552976608,
      "rmse_dtheta": 0.028867041692137718,
      "rmse_dx": 0.0069266255013644695,
      "rmse_dy": 0.0034965078812092543,
      "rmse_mean": 0.013096725568175316,
      "rotation_flip": 0.004556752275675535,
      "sparse_tokens": 32089.0,
      "step": 2318,
      "turn_loss": 0.08977364003658295,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10774019698940718,
      "grad_norm": 0.47024205327033997,
      "learning_rate": 9.178891615301989e-06,
      "loss": 0.1165,
      "mae_dtheta": 0.017176734283566475,
      "mae_dx": 0.0032083303667604923,
      "mae_dy": 0.00447175744920969,
      "pose_mae_dtheta": 0.12234900891780853,
      "pose_mae_dx": 0.043074075132608414,
      "pose_mae_dy": 0.03883768245577812,
      "pose_rmse_dtheta": 0.3127726912498474,
      "pose_rmse_dx": 0.1061348244547844,
      "pose_rmse_dy": 0.07888065278530121,
      "pose_rmse_mean": 0.1659294068813324,
      "rmse_dtheta": 0.03471263498067856,
      "rmse_dx": 0.008828559890389442,
      "rmse_dy": 0.009569438174366951,
      "rmse_mean": 0.017703544348478317,
      "rotation_flip": 0.006331339944154024,
      "sparse_tokens": 32089.0,
      "step": 2319,
      "turn_loss": 0.1580008715391159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.10778665675524995,
      "grad_norm": 0.49265462160110474,
      "learning_rate": 9.178165482274013e-06,
      "loss": 0.0944,
      "mae_dtheta": 0.006922874134033918,
      "mae_dx": 0.0017877441132441163,
      "mae_dy": 0.0010606955038383603,
      "pose_mae_dtheta": 0.05351049453020096,
      "pose_mae_dx": 0.015720674768090248,
      "pose_mae_dy": 0.015552220866084099,
      "pose_rmse_dtheta": 0.16890980303287506,
      "pose_rmse_dx": 0.05067959427833557,
      "pose_rmse_dy": 0.04258303344249725,
      "pose_rmse_mean": 0.08739081025123596,
      "rmse_dtheta": 0.019196417182683945,
      "rmse_dx": 0.006308659445494413,
      "rmse_dy": 0.002506075194105506,
      "rmse_mean": 0.009337050840258598,
      "rotation_flip": 0.0019656019285321236,
      "sparse_tokens": 32153.0,
      "step": 2320,
      "turn_loss": 0.05153154954314232,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.10783311652109273,
      "grad_norm": 0.5174954533576965,
      "learning_rate": 9.177439057064684e-06,
      "loss": 0.1433,
      "mae_dtheta": 0.02384379878640175,
      "mae_dx": 0.010654458776116371,
      "mae_dy": 0.003115098923444748,
      "pose_mae_dtheta": 0.15695732831954956,
      "pose_mae_dx": 0.08445317298173904,
      "pose_mae_dy": 0.03597843647003174,
      "pose_rmse_dtheta": 0.27151837944984436,
      "pose_rmse_dx": 0.19314849376678467,
      "pose_rmse_dy": 0.07898680865764618,
      "pose_rmse_mean": 0.18121789395809174,
      "rmse_dtheta": 0.040337175130844116,
      "rmse_dx": 0.022737352177500725,
      "rmse_dy": 0.005689449608325958,
      "rmse_mean": 0.022921327501535416,
      "rotation_flip": 0.0022123893722891808,
      "sparse_tokens": 9197.0,
      "step": 2321,
      "turn_loss": 0.224004328250885,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.10787957628693551,
      "grad_norm": 0.6242351531982422,
      "learning_rate": 9.176712339724797e-06,
      "loss": 0.1805,
      "mae_dtheta": 0.015174880623817444,
      "mae_dx": 0.002783203963190317,
      "mae_dy": 0.0031990394927561283,
      "pose_mae_dtheta": 0.09801214933395386,
      "pose_mae_dx": 0.030215462669730186,
      "pose_mae_dy": 0.03214665874838829,
      "pose_rmse_dtheta": 0.24213647842407227,
      "pose_rmse_dx": 0.0721445083618164,
      "pose_rmse_dy": 0.07412240654230118,
      "pose_rmse_mean": 0.12946780025959015,
      "rmse_dtheta": 0.031389445066452026,
      "rmse_dx": 0.007731943391263485,
      "rmse_dy": 0.006860093679279089,
      "rmse_mean": 0.01532716117799282,
      "rotation_flip": 0.00683293491601944,
      "sparse_tokens": 32169.0,
      "step": 2322,
      "turn_loss": 0.1366797685623169,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1079260360527783,
      "grad_norm": 0.4364035725593567,
      "learning_rate": 9.175985330305176e-06,
      "loss": 0.0967,
      "mae_dtheta": 0.010613837279379368,
      "mae_dx": 0.0026386503595858812,
      "mae_dy": 0.0028713573701679707,
      "pose_mae_dtheta": 0.07206596434116364,
      "pose_mae_dx": 0.029688775539398193,
      "pose_mae_dy": 0.0328138992190361,
      "pose_rmse_dtheta": 0.13700829446315765,
      "pose_rmse_dx": 0.06775134801864624,
      "pose_rmse_dy": 0.07363348454236984,
      "pose_rmse_mean": 0.09279771149158478,
      "rmse_dtheta": 0.020199086517095566,
      "rmse_dx": 0.006804646458476782,
      "rmse_dy": 0.006112122442573309,
      "rmse_mean": 0.011038619093596935,
      "rotation_flip": 0.005551150068640709,
      "sparse_tokens": 32105.0,
      "step": 2323,
      "turn_loss": 0.11074668914079666,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19481.0,
      "epoch": 0.10797249581862108,
      "grad_norm": 0.47658583521842957,
      "learning_rate": 9.17525802885666e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.029022719711065292,
      "mae_dx": 0.00919655617326498,
      "mae_dy": 0.004738742019981146,
      "pose_mae_dtheta": 0.20567040145397186,
      "pose_mae_dx": 0.08119791001081467,
      "pose_mae_dy": 0.07613316923379898,
      "pose_rmse_dtheta": 0.352875292301178,
      "pose_rmse_dx": 0.2113257795572281,
      "pose_rmse_dy": 0.1527675986289978,
      "pose_rmse_mean": 0.23898956179618835,
      "rmse_dtheta": 0.044474463909864426,
      "rmse_dx": 0.021665969863533974,
      "rmse_dy": 0.00753965275362134,
      "rmse_mean": 0.024560030549764633,
      "rotation_flip": 0.00856793113052845,
      "sparse_tokens": 15125.0,
      "step": 2324,
      "turn_loss": 0.2531293034553528,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.10801895558446385,
      "grad_norm": 0.6257674694061279,
      "learning_rate": 9.174530435430108e-06,
      "loss": 0.1689,
      "mae_dtheta": 0.030536552891135216,
      "mae_dx": 0.015323672443628311,
      "mae_dy": 0.005576255731284618,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6257672309875488,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 119.68260955810547,
      "model/head/act_norm_mean": 97.69560185185185,
      "model/head/act_norm_min": 77.42696380615234,
      "model/head/act_over_embed": 67.13733223322753,
      "model/head/grad_frac": 0.09733745455741882,
      "model/head/grad_norm": 0.06091058999300003,
      "model/head/grad_zero_frac": 0.00019004578643944114,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6929615162037037,
      "model/head/update_ratio": 0.0010547413257882,
      "model/head/weight_delta": 5.546648979187012,
      "model/head/weight_delta_rel": 0.09730464965105057,
      "model/head/weight_norm": 57.74931716918945,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4147353172302246,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4147353172302246,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4147353172302246,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.285009992813825,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06302912533283234,
      "model/modality_embedder.encoders.pose/grad_norm": 0.039441563189029694,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012815300142392516,
      "model/modality_embedder.encoders.pose/weight_delta": 1.7987960577011108,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05877227336168289,
      "model/modality_embedder.encoders.pose/weight_norm": 30.776933670043945,
      "model/modality_embedder/grad_frac": 0.06302912533283234,
      "model/modality_embedder/grad_norm": 0.039441563189029694,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0012815300142392516,
      "model/modality_embedder/weight_delta": 1.7987960577011108,
      "model/modality_embedder/weight_delta_rel": 0.05877227336168289,
      "model/modality_embedder/weight_norm": 30.776933670043945,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 62.7739372253418,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.29941716269841,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.380647659301758,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.324368244639057,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07523553818464279,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04707993566989899,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017041011014953256,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.1391819715499878,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04151247814297676,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.627431869506836,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 64.47323608398438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.233332414756028,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.8289794921875,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.966163549305396,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07029370218515396,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.043987493962049484,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001506111933849752,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.4254810810089111,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.049379777163267136,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.205991744995117,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 66.21952056884766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.93583278218695,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.096177101135254,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.13613774086349,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07563973218202591,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04733286798000336,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015702075324952602,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.5231947898864746,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05114603042602539,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.144338607788086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 67.20570373535156,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.921734916960613,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.21823787689209,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.500868280188662,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08921532332897186,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.055828023701906204,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018910880899056792,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.2989307641983032,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.044391289353370667,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.52164077758789,
      "model/normalizer/grad_frac": 0.3565793037414551,
      "model/normalizer/grad_norm": 0.22313565015792847,
      "model/normalizer/grad_zero_frac": 0.00023043899273034185,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0028598594944924116,
      "model/normalizer/weight_delta": 2.773768424987793,
      "model/normalizer/weight_delta_rel": 0.03572453185915947,
      "model/normalizer/weight_norm": 78.0232925415039,
      "pose_mae_dtheta": 0.25178423523902893,
      "pose_mae_dx": 0.1281880885362625,
      "pose_mae_dy": 0.058251045644283295,
      "pose_rmse_dtheta": 0.4014100730419159,
      "pose_rmse_dx": 0.2645999789237976,
      "pose_rmse_dy": 0.12611418962478638,
      "pose_rmse_mean": 0.2640414237976074,
      "rmse_dtheta": 0.04448293149471283,
      "rmse_dx": 0.028608927503228188,
      "rmse_dy": 0.012035861611366272,
      "rmse_mean": 0.028375906869769096,
      "rotation_flip": 0.004672897048294544,
      "sparse_tokens": 7024.0,
      "step": 2325,
      "turn_loss": 0.3939708471298218,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.10806541535030663,
      "grad_norm": 0.744102418422699,
      "learning_rate": 9.173802550076402e-06,
      "loss": 0.1171,
      "mae_dtheta": 0.0140700563788414,
      "mae_dx": 0.0035964478738605976,
      "mae_dy": 0.00366011424921453,
      "pose_mae_dtheta": 0.10370326787233353,
      "pose_mae_dx": 0.03250199556350708,
      "pose_mae_dy": 0.034763313829898834,
      "pose_rmse_dtheta": 0.22995679080486298,
      "pose_rmse_dx": 0.07701023668050766,
      "pose_rmse_dy": 0.07446486502885818,
      "pose_rmse_mean": 0.1271439641714096,
      "rmse_dtheta": 0.028707806020975113,
      "rmse_dx": 0.00954313762485981,
      "rmse_dy": 0.008336694911122322,
      "rmse_mean": 0.015529213473200798,
      "rotation_flip": 0.007035497110337019,
      "sparse_tokens": 32217.0,
      "step": 2326,
      "turn_loss": 0.13792555034160614,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.10811187511614942,
      "grad_norm": 0.4882524311542511,
      "learning_rate": 9.173074372846444e-06,
      "loss": 0.1576,
      "mae_dtheta": 0.037837784737348557,
      "mae_dx": 0.010345850139856339,
      "mae_dy": 0.005090381950139999,
      "pose_mae_dtheta": 0.2792739272117615,
      "pose_mae_dx": 0.0980827584862709,
      "pose_mae_dy": 0.0560758039355278,
      "pose_rmse_dtheta": 0.48559191823005676,
      "pose_rmse_dx": 0.24415218830108643,
      "pose_rmse_dy": 0.1132088303565979,
      "pose_rmse_mean": 0.2809843122959137,
      "rmse_dtheta": 0.05588029697537422,
      "rmse_dx": 0.023701738566160202,
      "rmse_dy": 0.009829234331846237,
      "rmse_mean": 0.02980375848710537,
      "rotation_flip": 0.026929982006549835,
      "sparse_tokens": 10362.0,
      "step": 2327,
      "turn_loss": 0.2732159197330475,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1081583348819922,
      "grad_norm": 0.4912419319152832,
      "learning_rate": 9.172345903791155e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.00940482597798109,
      "mae_dx": 0.0018065342446789145,
      "mae_dy": 0.0022383364848792553,
      "pose_mae_dtheta": 0.06526917219161987,
      "pose_mae_dx": 0.0275429654866457,
      "pose_mae_dy": 0.03216974437236786,
      "pose_rmse_dtheta": 0.1373010277748108,
      "pose_rmse_dx": 0.07126884907484055,
      "pose_rmse_dy": 0.07856880128383636,
      "pose_rmse_mean": 0.09571290016174316,
      "rmse_dtheta": 0.018063969910144806,
      "rmse_dx": 0.005075716879218817,
      "rmse_dy": 0.004760007373988628,
      "rmse_mean": 0.009299898520112038,
      "rotation_flip": 0.004260263405740261,
      "sparse_tokens": 32105.0,
      "step": 2328,
      "turn_loss": 0.08552252501249313,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.10820479464783497,
      "grad_norm": 0.5360201001167297,
      "learning_rate": 9.171617142961477e-06,
      "loss": 0.1296,
      "mae_dtheta": 0.013603472150862217,
      "mae_dx": 0.003691099351271987,
      "mae_dy": 0.004251614212989807,
      "pose_mae_dtheta": 0.09502817690372467,
      "pose_mae_dx": 0.038885217159986496,
      "pose_mae_dy": 0.035463158041238785,
      "pose_rmse_dtheta": 0.2098807841539383,
      "pose_rmse_dx": 0.10398080199956894,
      "pose_rmse_dy": 0.08230417221784592,
      "pose_rmse_mean": 0.13205525279045105,
      "rmse_dtheta": 0.02967282012104988,
      "rmse_dx": 0.0088600879535079,
      "rmse_dy": 0.00925328116863966,
      "rmse_mean": 0.015928730368614197,
      "rotation_flip": 0.004421983379870653,
      "sparse_tokens": 32201.0,
      "step": 2329,
      "turn_loss": 0.1472446173429489,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.10825125441367775,
      "grad_norm": 0.5142195820808411,
      "learning_rate": 9.170888090408374e-06,
      "loss": 0.1548,
      "mae_dtheta": 0.014721452258527279,
      "mae_dx": 0.003889926243573427,
      "mae_dy": 0.0037157488986849785,
      "pose_mae_dtheta": 0.10924666374921799,
      "pose_mae_dx": 0.03812865540385246,
      "pose_mae_dy": 0.03738127276301384,
      "pose_rmse_dtheta": 0.26565679907798767,
      "pose_rmse_dx": 0.09003157913684845,
      "pose_rmse_dy": 0.08797060698270798,
      "pose_rmse_mean": 0.14788633584976196,
      "rmse_dtheta": 0.030761510133743286,
      "rmse_dx": 0.011159082874655724,
      "rmse_dy": 0.00872340239584446,
      "rmse_mean": 0.01688133180141449,
      "rotation_flip": 0.006617903243750334,
      "sparse_tokens": 32137.0,
      "step": 2330,
      "turn_loss": 0.133814737200737,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10829771417952054,
      "grad_norm": 0.47175440192222595,
      "learning_rate": 9.170158746182827e-06,
      "loss": 0.1032,
      "mae_dtheta": 0.011672001332044601,
      "mae_dx": 0.0022571594454348087,
      "mae_dy": 0.0034656838979572058,
      "pose_mae_dtheta": 0.07734325528144836,
      "pose_mae_dx": 0.03396688029170036,
      "pose_mae_dy": 0.03803291916847229,
      "pose_rmse_dtheta": 0.13615675270557404,
      "pose_rmse_dx": 0.07929132878780365,
      "pose_rmse_dy": 0.07584790885448456,
      "pose_rmse_mean": 0.09709867089986801,
      "rmse_dtheta": 0.020442631095647812,
      "rmse_dx": 0.006594195030629635,
      "rmse_dy": 0.006623735651373863,
      "rmse_mean": 0.011220186948776245,
      "rotation_flip": 0.006741573102772236,
      "sparse_tokens": 32105.0,
      "step": 2331,
      "turn_loss": 0.10998328775167465,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19096.0,
      "epoch": 0.10834417394536332,
      "grad_norm": 0.4586608111858368,
      "learning_rate": 9.169429110335842e-06,
      "loss": 0.1037,
      "mae_dtheta": 0.02975527197122574,
      "mae_dx": 0.010266922414302826,
      "mae_dy": 0.0021230150014162064,
      "pose_mae_dtheta": 0.2477981001138687,
      "pose_mae_dx": 0.0786038264632225,
      "pose_mae_dy": 0.023217620328068733,
      "pose_rmse_dtheta": 0.5275207161903381,
      "pose_rmse_dx": 0.20046135783195496,
      "pose_rmse_dy": 0.069450244307518,
      "pose_rmse_mean": 0.2658107876777649,
      "rmse_dtheta": 0.05266676843166351,
      "rmse_dx": 0.02219858020544052,
      "rmse_dy": 0.0052702040411531925,
      "rmse_mean": 0.026711851358413696,
      "rotation_flip": 0.015727391466498375,
      "sparse_tokens": 15248.0,
      "step": 2332,
      "turn_loss": 0.1903030425310135,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.1083906337112061,
      "grad_norm": 0.657062828540802,
      "learning_rate": 9.168699182918442e-06,
      "loss": 0.1658,
      "mae_dtheta": 0.05222006142139435,
      "mae_dx": 0.01643829606473446,
      "mae_dy": 0.003547418862581253,
      "pose_mae_dtheta": 0.43240901827812195,
      "pose_mae_dx": 0.1357782930135727,
      "pose_mae_dy": 0.040078531950712204,
      "pose_rmse_dtheta": 0.6494331955909729,
      "pose_rmse_dx": 0.2842009961605072,
      "pose_rmse_dy": 0.09260095655918121,
      "pose_rmse_mean": 0.34207838773727417,
      "rmse_dtheta": 0.06836722791194916,
      "rmse_dx": 0.029618866741657257,
      "rmse_dy": 0.007913382723927498,
      "rmse_mean": 0.03529982641339302,
      "rotation_flip": 0.010709504596889019,
      "sparse_tokens": 10878.0,
      "step": 2333,
      "turn_loss": 0.3770773112773895,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.10843709347704887,
      "grad_norm": 0.5500065684318542,
      "learning_rate": 9.167968963981668e-06,
      "loss": 0.1416,
      "mae_dtheta": 0.010379188694059849,
      "mae_dx": 0.0020910247694700956,
      "mae_dy": 0.0024993105325847864,
      "pose_mae_dtheta": 0.0686347708106041,
      "pose_mae_dx": 0.025246325880289078,
      "pose_mae_dy": 0.030683351680636406,
      "pose_rmse_dtheta": 0.16858091950416565,
      "pose_rmse_dx": 0.06497811526060104,
      "pose_rmse_dy": 0.08439620584249496,
      "pose_rmse_mean": 0.10598509013652802,
      "rmse_dtheta": 0.022204598411917686,
      "rmse_dx": 0.006989289075136185,
      "rmse_dy": 0.006253792904317379,
      "rmse_mean": 0.011815893463790417,
      "rotation_flip": 0.007029877044260502,
      "sparse_tokens": 32057.0,
      "step": 2334,
      "turn_loss": 0.08391416817903519,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.10848355324289166,
      "grad_norm": 0.49446654319763184,
      "learning_rate": 9.167238453576589e-06,
      "loss": 0.1566,
      "mae_dtheta": 0.02796425297856331,
      "mae_dx": 0.005462217144668102,
      "mae_dy": 0.005269902758300304,
      "pose_mae_dtheta": 0.19394145905971527,
      "pose_mae_dx": 0.05857159569859505,
      "pose_mae_dy": 0.07394461333751678,
      "pose_rmse_dtheta": 0.3363429605960846,
      "pose_rmse_dx": 0.1557525247335434,
      "pose_rmse_dy": 0.14942750334739685,
      "pose_rmse_mean": 0.2138410061597824,
      "rmse_dtheta": 0.043488357216119766,
      "rmse_dx": 0.014972745440900326,
      "rmse_dy": 0.009187363088130951,
      "rmse_mean": 0.022549491375684738,
      "rotation_flip": 0.024077046662569046,
      "sparse_tokens": 12729.0,
      "step": 2335,
      "turn_loss": 0.21185128390789032,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.10853001300873444,
      "grad_norm": 0.707586944103241,
      "learning_rate": 9.166507651754289e-06,
      "loss": 0.1633,
      "mae_dtheta": 0.009621404111385345,
      "mae_dx": 0.0017297589220106602,
      "mae_dy": 0.0023937555961310863,
      "pose_mae_dtheta": 0.06476982682943344,
      "pose_mae_dx": 0.020441971719264984,
      "pose_mae_dy": 0.02736925147473812,
      "pose_rmse_dtheta": 0.14460837841033936,
      "pose_rmse_dx": 0.05073898285627365,
      "pose_rmse_dy": 0.07248713076114655,
      "pose_rmse_mean": 0.08927816152572632,
      "rmse_dtheta": 0.02173381857573986,
      "rmse_dx": 0.004349259193986654,
      "rmse_dy": 0.005580446217209101,
      "rmse_mean": 0.010554509237408638,
      "rotation_flip": 0.007949125953018665,
      "sparse_tokens": 32153.0,
      "step": 2336,
      "turn_loss": 0.0864262729883194,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.10857647277457722,
      "grad_norm": 0.604670524597168,
      "learning_rate": 9.16577655856587e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.02746545523405075,
      "mae_dx": 0.00876285694539547,
      "mae_dy": 0.005257566459476948,
      "pose_mae_dtheta": 0.1891995668411255,
      "pose_mae_dx": 0.052861206233501434,
      "pose_mae_dy": 0.04446239396929741,
      "pose_rmse_dtheta": 0.35241037607192993,
      "pose_rmse_dx": 0.14258477091789246,
      "pose_rmse_dy": 0.12118342518806458,
      "pose_rmse_mean": 0.20539286732673645,
      "rmse_dtheta": 0.04572618752717972,
      "rmse_dx": 0.0191884133964777,
      "rmse_dy": 0.012738372199237347,
      "rmse_mean": 0.025884322822093964,
      "rotation_flip": 0.006259780842810869,
      "sparse_tokens": 11372.0,
      "step": 2337,
      "turn_loss": 0.2450132966041565,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.10862293254041999,
      "grad_norm": 0.47992047667503357,
      "learning_rate": 9.165045174062463e-06,
      "loss": 0.1383,
      "mae_dtheta": 0.008199048228561878,
      "mae_dx": 0.0024570845998823643,
      "mae_dy": 0.0014879206428304315,
      "pose_mae_dtheta": 0.05735600367188454,
      "pose_mae_dx": 0.021056076511740685,
      "pose_mae_dy": 0.01874256134033203,
      "pose_rmse_dtheta": 0.17376308143138885,
      "pose_rmse_dx": 0.05388684943318367,
      "pose_rmse_dy": 0.06234803795814514,
      "pose_rmse_mean": 0.09666599333286285,
      "rmse_dtheta": 0.02206302620470524,
      "rmse_dx": 0.006981340236961842,
      "rmse_dy": 0.004778396803885698,
      "rmse_mean": 0.011274254880845547,
      "rotation_flip": 0.002532928017899394,
      "sparse_tokens": 32169.0,
      "step": 2338,
      "turn_loss": 0.09054706990718842,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.10866939230626278,
      "grad_norm": 0.6253333687782288,
      "learning_rate": 9.16431349829521e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.008141711354255676,
      "mae_dx": 0.0020309286192059517,
      "mae_dy": 0.0003741168475244194,
      "pose_mae_dtheta": 0.06197033450007439,
      "pose_mae_dx": 0.015528634190559387,
      "pose_mae_dy": 0.004917489364743233,
      "pose_rmse_dtheta": 0.25607964396476746,
      "pose_rmse_dx": 0.04264601320028305,
      "pose_rmse_dy": 0.010905429720878601,
      "pose_rmse_mean": 0.10321037471294403,
      "rmse_dtheta": 0.028545645996928215,
      "rmse_dx": 0.006444938015192747,
      "rmse_dy": 0.000628958223387599,
      "rmse_mean": 0.011873180978000164,
      "rotation_flip": 0.0020283975172787905,
      "sparse_tokens": 32137.0,
      "step": 2339,
      "turn_loss": 0.051970694214105606,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.10871585207210556,
      "grad_norm": 0.501691997051239,
      "learning_rate": 9.16358153131528e-06,
      "loss": 0.1528,
      "mae_dtheta": 0.03389853239059448,
      "mae_dx": 0.013616814278066158,
      "mae_dy": 0.003784334287047386,
      "pose_mae_dtheta": 0.25627201795578003,
      "pose_mae_dx": 0.10995358228683472,
      "pose_mae_dy": 0.0387970507144928,
      "pose_rmse_dtheta": 0.45332208275794983,
      "pose_rmse_dx": 0.22681967914104462,
      "pose_rmse_dy": 0.0933728814125061,
      "pose_rmse_mean": 0.2578382194042206,
      "rmse_dtheta": 0.052157528698444366,
      "rmse_dx": 0.02625257521867752,
      "rmse_dy": 0.0083706583827734,
      "rmse_mean": 0.028926922008395195,
      "rotation_flip": 0.011080332100391388,
      "sparse_tokens": 20474.0,
      "step": 2340,
      "turn_loss": 0.28950175642967224,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.10876231183794834,
      "grad_norm": 0.5417078137397766,
      "learning_rate": 9.162849273173857e-06,
      "loss": 0.1142,
      "mae_dtheta": 0.010057440027594566,
      "mae_dx": 0.0016500805504620075,
      "mae_dy": 0.0018655355088412762,
      "pose_mae_dtheta": 0.07338772714138031,
      "pose_mae_dx": 0.02508683130145073,
      "pose_mae_dy": 0.031291794031858444,
      "pose_rmse_dtheta": 0.20527951419353485,
      "pose_rmse_dx": 0.06236004829406738,
      "pose_rmse_dy": 0.08271122723817825,
      "pose_rmse_mean": 0.11678360402584076,
      "rmse_dtheta": 0.02545410394668579,
      "rmse_dx": 0.004627498798072338,
      "rmse_dy": 0.004379068035632372,
      "rmse_mean": 0.011486890725791454,
      "rotation_flip": 0.0023137435782700777,
      "sparse_tokens": 32105.0,
      "step": 2341,
      "turn_loss": 0.0762905552983284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.10880877160379111,
      "grad_norm": 0.5374801158905029,
      "learning_rate": 9.162116723922152e-06,
      "loss": 0.1335,
      "mae_dtheta": 0.007425772491842508,
      "mae_dx": 0.001496927230618894,
      "mae_dy": 0.0013833414996042848,
      "pose_mae_dtheta": 0.053547076880931854,
      "pose_mae_dx": 0.019672473892569542,
      "pose_mae_dy": 0.01826380006968975,
      "pose_rmse_dtheta": 0.17522920668125153,
      "pose_rmse_dx": 0.061776407063007355,
      "pose_rmse_dy": 0.0663011372089386,
      "pose_rmse_mean": 0.10110225528478622,
      "rmse_dtheta": 0.021928153932094574,
      "rmse_dx": 0.004996828269213438,
      "rmse_dy": 0.003985294606536627,
      "rmse_mean": 0.010303426533937454,
      "rotation_flip": 0.0035419126506894827,
      "sparse_tokens": 32073.0,
      "step": 2342,
      "turn_loss": 0.048992011696100235,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.1088552313696339,
      "grad_norm": 0.8243674039840698,
      "learning_rate": 9.16138388361139e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.03343423455953598,
      "mae_dx": 0.016326334327459335,
      "mae_dy": 0.005327543709427118,
      "pose_mae_dtheta": 0.25823014974594116,
      "pose_mae_dx": 0.14498843252658844,
      "pose_mae_dy": 0.09781859070062637,
      "pose_rmse_dtheta": 0.4451645016670227,
      "pose_rmse_dx": 0.27411746978759766,
      "pose_rmse_dy": 0.17176273465156555,
      "pose_rmse_mean": 0.29701492190361023,
      "rmse_dtheta": 0.04887514188885689,
      "rmse_dx": 0.03038836643099785,
      "rmse_dy": 0.007927874103188515,
      "rmse_mean": 0.029063794761896133,
      "rotation_flip": 0.01604278013110161,
      "sparse_tokens": 3166.0,
      "step": 2343,
      "turn_loss": 0.221216082572937,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.10890169113547668,
      "grad_norm": 0.4755129814147949,
      "learning_rate": 9.160650752292819e-06,
      "loss": 0.134,
      "mae_dtheta": 0.023612845689058304,
      "mae_dx": 0.00571396853774786,
      "mae_dy": 0.00225168582983315,
      "pose_mae_dtheta": 0.22227545082569122,
      "pose_mae_dx": 0.05036405846476555,
      "pose_mae_dy": 0.03775273635983467,
      "pose_rmse_dtheta": 0.47471854090690613,
      "pose_rmse_dx": 0.15653106570243835,
      "pose_rmse_dy": 0.08443211764097214,
      "pose_rmse_mean": 0.23856058716773987,
      "rmse_dtheta": 0.04430118575692177,
      "rmse_dx": 0.016111506149172783,
      "rmse_dy": 0.004830597899854183,
      "rmse_mean": 0.021747764199972153,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 5068.0,
      "step": 2344,
      "turn_loss": 0.08207880705595016,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.10894815090131946,
      "grad_norm": 1.29275381565094,
      "learning_rate": 9.159917330017707e-06,
      "loss": 0.3033,
      "mae_dtheta": 0.043372590094804764,
      "mae_dx": 0.009617776609957218,
      "mae_dy": 0.007017416413873434,
      "pose_mae_dtheta": 0.3606279194355011,
      "pose_mae_dx": 0.06545151770114899,
      "pose_mae_dy": 0.07388615608215332,
      "pose_rmse_dtheta": 0.6041525602340698,
      "pose_rmse_dx": 0.16223746538162231,
      "pose_rmse_dy": 0.1900942325592041,
      "pose_rmse_mean": 0.31882810592651367,
      "rmse_dtheta": 0.06284409761428833,
      "rmse_dx": 0.020507747307419777,
      "rmse_dy": 0.014771195128560066,
      "rmse_mean": 0.03270768001675606,
      "rotation_flip": 0.01944444514811039,
      "sparse_tokens": 12020.0,
      "step": 2345,
      "turn_loss": 0.34549736976623535,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.10899461066716223,
      "grad_norm": 0.6382890939712524,
      "learning_rate": 9.159183616837345e-06,
      "loss": 0.0897,
      "mae_dtheta": 0.03314230591058731,
      "mae_dx": 0.008603881113231182,
      "mae_dy": 0.0033274793531745672,
      "pose_mae_dtheta": 0.2500441074371338,
      "pose_mae_dx": 0.056722577661275864,
      "pose_mae_dy": 0.03552542254328728,
      "pose_rmse_dtheta": 0.4633370041847229,
      "pose_rmse_dx": 0.1256076693534851,
      "pose_rmse_dy": 0.09267981350421906,
      "pose_rmse_mean": 0.22720816731452942,
      "rmse_dtheta": 0.052097998559474945,
      "rmse_dx": 0.018825728446245193,
      "rmse_dy": 0.006871778983622789,
      "rmse_mean": 0.025931838899850845,
      "rotation_flip": 0.008658008649945259,
      "sparse_tokens": 7324.0,
      "step": 2346,
      "turn_loss": 0.2103339582681656,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.10904107043300502,
      "grad_norm": 0.8186438679695129,
      "learning_rate": 9.158449612803039e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.04078797996044159,
      "mae_dx": 0.01006370596587658,
      "mae_dy": 0.0036515993997454643,
      "pose_mae_dtheta": 0.32841968536376953,
      "pose_mae_dx": 0.07209409028291702,
      "pose_mae_dy": 0.03502877801656723,
      "pose_rmse_dtheta": 0.5700975060462952,
      "pose_rmse_dx": 0.18846015632152557,
      "pose_rmse_dy": 0.07400166243314743,
      "pose_rmse_mean": 0.2775197923183441,
      "rmse_dtheta": 0.06102743372321129,
      "rmse_dx": 0.021156316623091698,
      "rmse_dy": 0.008380438201129436,
      "rmse_mean": 0.03018806129693985,
      "rotation_flip": 0.018214935436844826,
      "sparse_tokens": 9366.0,
      "step": 2347,
      "turn_loss": 0.33873698115348816,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.1090875301988478,
      "grad_norm": 0.5717059969902039,
      "learning_rate": 9.15771531796612e-06,
      "loss": 0.1223,
      "mae_dtheta": 0.02432081662118435,
      "mae_dx": 0.0038258973509073257,
      "mae_dy": 0.00327305612154305,
      "pose_mae_dtheta": 0.20728696882724762,
      "pose_mae_dx": 0.03863152489066124,
      "pose_mae_dy": 0.053025949746370316,
      "pose_rmse_dtheta": 0.40529629588127136,
      "pose_rmse_dx": 0.08312735706567764,
      "pose_rmse_dy": 0.14192597568035126,
      "pose_rmse_mean": 0.21011655032634735,
      "rmse_dtheta": 0.04474181681871414,
      "rmse_dx": 0.009463795460760593,
      "rmse_dy": 0.007129032630473375,
      "rmse_mean": 0.020444881170988083,
      "rotation_flip": 0.0,
      "sparse_tokens": 5394.0,
      "step": 2348,
      "turn_loss": 0.16842225193977356,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 21747.0,
      "epoch": 0.10913398996469058,
      "grad_norm": 0.6370829343795776,
      "learning_rate": 9.156980732377938e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.02469434030354023,
      "mae_dx": 0.010206999257206917,
      "mae_dy": 0.003945068921893835,
      "pose_mae_dtheta": 0.17126192152500153,
      "pose_mae_dx": 0.08196303993463516,
      "pose_mae_dy": 0.05061357468366623,
      "pose_rmse_dtheta": 0.3204863965511322,
      "pose_rmse_dx": 0.20599184930324554,
      "pose_rmse_dy": 0.10076150298118591,
      "pose_rmse_mean": 0.20907990634441376,
      "rmse_dtheta": 0.04059167206287384,
      "rmse_dx": 0.022842727601528168,
      "rmse_dy": 0.007077567745000124,
      "rmse_mean": 0.023503988981246948,
      "rotation_flip": 0.016489988192915916,
      "sparse_tokens": 17821.0,
      "step": 2349,
      "turn_loss": 0.1867782324552536,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.10918044973053335,
      "grad_norm": 0.7762335538864136,
      "learning_rate": 9.156245856089861e-06,
      "loss": 0.0873,
      "mae_dtheta": 0.03713607043027878,
      "mae_dx": 0.014124646782875061,
      "mae_dy": 0.006682081613689661,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7762334942817688,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 135.01071166992188,
      "model/head/act_norm_mean": 102.59723221628289,
      "model/head/act_norm_min": 74.22821807861328,
      "model/head/act_over_embed": 70.50577850945102,
      "model/head/grad_frac": 0.07646272331476212,
      "model/head/grad_norm": 0.05935292690992355,
      "model/head/grad_zero_frac": 0.00014245502825360745,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6898129111842105,
      "model/head/update_ratio": 0.0010276285465806723,
      "model/head/weight_delta": 5.578615188598633,
      "model/head/weight_delta_rel": 0.09786543250083923,
      "model/head/weight_norm": 57.75718307495117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41484546661376953,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41484546661376953,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41484546661376953,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28508568850143184,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09520778805017471,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07390347123146057,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0024011016357690096,
      "model/modality_embedder.encoders.pose/weight_delta": 1.8075897693634033,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.059059590101242065,
      "model/modality_embedder.encoders.pose/weight_norm": 30.77898597717285,
      "model/modality_embedder/grad_frac": 0.09520778805017471,
      "model/modality_embedder/grad_norm": 0.07390347123146057,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0024011016357690096,
      "model/modality_embedder/weight_delta": 1.8075897693634033,
      "model/modality_embedder/weight_delta_rel": 0.059059590101242065,
      "model/modality_embedder/weight_norm": 30.77898597717285,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 66.56246948242188,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.762820136278197,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.155158042907715,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.642823106530079,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05776175856590271,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.044836610555648804,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016227496089413762,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.1492081880569458,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04187783971428871,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.630023956298828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 67.4515380859375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.686979493003342,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.455309867858887,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.277914068587812,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06013324856758118,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04667744040489197,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015980248572304845,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.4384214878082275,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.049828045070171356,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.20945930480957,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 69.44039916992188,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.416793937969924,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.57066822052002,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.466658749946834,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07001926004886627,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05435129627585411,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018028048798441887,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.5374417304992676,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05162441357970238,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.14818572998047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 69.58943939208984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.45667554302423,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.1393461227417,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.868484486612626,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08134035021066666,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06313910335302353,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 6.0522917920025066e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002138606272637844,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.311479091644287,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.04482012987136841,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.523483276367188,
      "model/normalizer/grad_frac": 0.29314500093460083,
      "model/normalizer/grad_norm": 0.22754895687103271,
      "model/normalizer/grad_zero_frac": 0.00011108341277576983,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00291627598926425,
      "model/normalizer/weight_delta": 2.799508810043335,
      "model/normalizer/weight_delta_rel": 0.03605605289340019,
      "model/normalizer/weight_norm": 78.02723693847656,
      "pose_mae_dtheta": 0.3200429081916809,
      "pose_mae_dx": 0.13748984038829803,
      "pose_mae_dy": 0.10750006884336472,
      "pose_rmse_dtheta": 0.5436187386512756,
      "pose_rmse_dx": 0.27481770515441895,
      "pose_rmse_dy": 0.2726024389266968,
      "pose_rmse_mean": 0.3636796474456787,
      "rmse_dtheta": 0.05345252901315689,
      "rmse_dx": 0.02593303844332695,
      "rmse_dy": 0.012865271419286728,
      "rmse_mean": 0.030750280246138573,
      "rotation_flip": 0.018115941435098648,
      "sparse_tokens": 4531.0,
      "step": 2350,
      "turn_loss": 0.2212209701538086,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.10922690949637613,
      "grad_norm": 0.5332110524177551,
      "learning_rate": 9.155510689153282e-06,
      "loss": 0.1908,
      "mae_dtheta": 0.031174417585134506,
      "mae_dx": 0.007705632597208023,
      "mae_dy": 0.003359910100698471,
      "pose_mae_dtheta": 0.2770416736602783,
      "pose_mae_dx": 0.0631079152226448,
      "pose_mae_dy": 0.050943806767463684,
      "pose_rmse_dtheta": 0.5734251141548157,
      "pose_rmse_dx": 0.18812374770641327,
      "pose_rmse_dy": 0.146534264087677,
      "pose_rmse_mean": 0.3026943802833557,
      "rmse_dtheta": 0.05483708158135414,
      "rmse_dx": 0.020379353314638138,
      "rmse_dy": 0.006827688310295343,
      "rmse_mean": 0.027348041534423828,
      "rotation_flip": 0.01123595517128706,
      "sparse_tokens": 15996.0,
      "step": 2351,
      "turn_loss": 0.20345482230186462,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.10927336926221892,
      "grad_norm": 1.0596556663513184,
      "learning_rate": 9.154775231619608e-06,
      "loss": 0.2664,
      "mae_dtheta": 0.04813368618488312,
      "mae_dx": 0.01606340892612934,
      "mae_dy": 0.006193234119564295,
      "pose_mae_dtheta": 0.3819706439971924,
      "pose_mae_dx": 0.11427165567874908,
      "pose_mae_dy": 0.08592899888753891,
      "pose_rmse_dtheta": 0.6019172072410583,
      "pose_rmse_dx": 0.23412925004959106,
      "pose_rmse_dy": 0.1768655776977539,
      "pose_rmse_mean": 0.33763736486434937,
      "rmse_dtheta": 0.06473447382450104,
      "rmse_dx": 0.028550418093800545,
      "rmse_dy": 0.010909900069236755,
      "rmse_mean": 0.03473159670829773,
      "rotation_flip": 0.011004126630723476,
      "sparse_tokens": 10472.0,
      "step": 2352,
      "turn_loss": 0.35710713267326355,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1093198290280617,
      "grad_norm": 0.5592877864837646,
      "learning_rate": 9.154039483540273e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.009692089632153511,
      "mae_dx": 0.001690251985564828,
      "mae_dy": 0.0020124996080994606,
      "pose_mae_dtheta": 0.06916776299476624,
      "pose_mae_dx": 0.020510587841272354,
      "pose_mae_dy": 0.0227710772305727,
      "pose_rmse_dtheta": 0.19269293546676636,
      "pose_rmse_dx": 0.0501251220703125,
      "pose_rmse_dy": 0.05428147688508034,
      "pose_rmse_mean": 0.0990331768989563,
      "rmse_dtheta": 0.02393965981900692,
      "rmse_dx": 0.0047170682810246944,
      "rmse_dy": 0.005361524876207113,
      "rmse_mean": 0.011339417658746243,
      "rotation_flip": 0.0017961383564397693,
      "sparse_tokens": 32105.0,
      "step": 2353,
      "turn_loss": 0.08379410952329636,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14295.0,
      "epoch": 0.10936628879390448,
      "grad_norm": 1.2174338102340698,
      "learning_rate": 9.153303444966728e-06,
      "loss": 0.3026,
      "mae_dtheta": 0.04059189185500145,
      "mae_dx": 0.012002349831163883,
      "mae_dy": 0.011141794733703136,
      "pose_mae_dtheta": 0.3203538954257965,
      "pose_mae_dx": 0.11912015825510025,
      "pose_mae_dy": 0.09834063798189163,
      "pose_rmse_dtheta": 0.5643272399902344,
      "pose_rmse_dx": 0.2267039716243744,
      "pose_rmse_dy": 0.21528074145317078,
      "pose_rmse_mean": 0.3354373574256897,
      "rmse_dtheta": 0.05986128747463226,
      "rmse_dx": 0.022420141845941544,
      "rmse_dy": 0.02185361087322235,
      "rmse_mean": 0.03471168130636215,
      "rotation_flip": 0.015600623562932014,
      "sparse_tokens": 12108.0,
      "step": 2354,
      "turn_loss": 0.4106994867324829,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10941274855974725,
      "grad_norm": 0.5725682973861694,
      "learning_rate": 9.152567115950444e-06,
      "loss": 0.1719,
      "mae_dtheta": 0.011367595754563808,
      "mae_dx": 0.0028318525291979313,
      "mae_dy": 0.003125097369775176,
      "pose_mae_dtheta": 0.07942061871290207,
      "pose_mae_dx": 0.03299766778945923,
      "pose_mae_dy": 0.03771865740418434,
      "pose_rmse_dtheta": 0.1850821077823639,
      "pose_rmse_dx": 0.09296625852584839,
      "pose_rmse_dy": 0.0921873077750206,
      "pose_rmse_mean": 0.12341189384460449,
      "rmse_dtheta": 0.024240370839834213,
      "rmse_dx": 0.009440772235393524,
      "rmse_dy": 0.006709663663059473,
      "rmse_mean": 0.01346360333263874,
      "rotation_flip": 0.006188118830323219,
      "sparse_tokens": 32089.0,
      "step": 2355,
      "turn_loss": 0.11796978861093521,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.10945920832559004,
      "grad_norm": 0.7667976021766663,
      "learning_rate": 9.151830496542912e-06,
      "loss": 0.113,
      "mae_dtheta": 0.01220313273370266,
      "mae_dx": 0.0027947411872446537,
      "mae_dy": 0.0023648482747375965,
      "pose_mae_dtheta": 0.09158991277217865,
      "pose_mae_dx": 0.029189692810177803,
      "pose_mae_dy": 0.030027786269783974,
      "pose_rmse_dtheta": 0.2384103238582611,
      "pose_rmse_dx": 0.07831455767154694,
      "pose_rmse_dy": 0.07880309224128723,
      "pose_rmse_mean": 0.13184267282485962,
      "rmse_dtheta": 0.029055379331111908,
      "rmse_dx": 0.008624032139778137,
      "rmse_dy": 0.0059752133674919605,
      "rmse_mean": 0.014551541768014431,
      "rotation_flip": 0.008285862393677235,
      "sparse_tokens": 32089.0,
      "step": 2356,
      "turn_loss": 0.09952141344547272,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.10950566809143282,
      "grad_norm": 0.4882987141609192,
      "learning_rate": 9.151093586795646e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.010670152492821217,
      "mae_dx": 0.0031182037200778723,
      "mae_dy": 0.002368596149608493,
      "pose_mae_dtheta": 0.07272849231958389,
      "pose_mae_dx": 0.029405124485492706,
      "pose_mae_dy": 0.029127968475222588,
      "pose_rmse_dtheta": 0.17323967814445496,
      "pose_rmse_dx": 0.06625795364379883,
      "pose_rmse_dy": 0.06973575800657272,
      "pose_rmse_mean": 0.10307779908180237,
      "rmse_dtheta": 0.023429227992892265,
      "rmse_dx": 0.008117315359413624,
      "rmse_dy": 0.00518364692106843,
      "rmse_mean": 0.012243397533893585,
      "rotation_flip": 0.004922377876937389,
      "sparse_tokens": 32185.0,
      "step": 2357,
      "turn_loss": 0.10386604070663452,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.1095521278572756,
      "grad_norm": 0.6914493441581726,
      "learning_rate": 9.150356386760174e-06,
      "loss": 0.1868,
      "mae_dtheta": 0.030021749436855316,
      "mae_dx": 0.01122828759253025,
      "mae_dy": 0.0027823317795991898,
      "pose_mae_dtheta": 0.24709850549697876,
      "pose_mae_dx": 0.09424802660942078,
      "pose_mae_dy": 0.02245446853339672,
      "pose_rmse_dtheta": 0.46387457847595215,
      "pose_rmse_dx": 0.23446986079216003,
      "pose_rmse_dy": 0.04886287450790405,
      "pose_rmse_mean": 0.24906912446022034,
      "rmse_dtheta": 0.04832836985588074,
      "rmse_dx": 0.024278549477458,
      "rmse_dy": 0.006307385396212339,
      "rmse_mean": 0.02630477026104927,
      "rotation_flip": 0.008438818156719208,
      "sparse_tokens": 11561.0,
      "step": 2358,
      "turn_loss": 0.2345798909664154,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.10959858762311837,
      "grad_norm": 0.5035114884376526,
      "learning_rate": 9.149618896488056e-06,
      "loss": 0.1072,
      "mae_dtheta": 0.012421797029674053,
      "mae_dx": 0.0026317420415580273,
      "mae_dy": 0.002153804525732994,
      "pose_mae_dtheta": 0.09609376639127731,
      "pose_mae_dx": 0.027672989293932915,
      "pose_mae_dy": 0.030146978795528412,
      "pose_rmse_dtheta": 0.28401219844818115,
      "pose_rmse_dx": 0.09171546250581741,
      "pose_rmse_dy": 0.11635934561491013,
      "pose_rmse_mean": 0.16402900218963623,
      "rmse_dtheta": 0.03177716210484505,
      "rmse_dx": 0.008276418782770634,
      "rmse_dy": 0.007346493657678366,
      "rmse_mean": 0.015800025314092636,
      "rotation_flip": 0.0016556291375309229,
      "sparse_tokens": 32137.0,
      "step": 2359,
      "turn_loss": 0.09804581105709076,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.10964504738896116,
      "grad_norm": 0.47851231694221497,
      "learning_rate": 9.14888111603086e-06,
      "loss": 0.1439,
      "mae_dtheta": 0.0391266793012619,
      "mae_dx": 0.013616828247904778,
      "mae_dy": 0.002571740420535207,
      "pose_mae_dtheta": 0.30179446935653687,
      "pose_mae_dx": 0.10529857873916626,
      "pose_mae_dy": 0.029879720881581306,
      "pose_rmse_dtheta": 0.5353110432624817,
      "pose_rmse_dx": 0.22542619705200195,
      "pose_rmse_dy": 0.08521045744419098,
      "pose_rmse_mean": 0.28198257088661194,
      "rmse_dtheta": 0.05852070823311806,
      "rmse_dx": 0.02543037012219429,
      "rmse_dy": 0.005850763060152531,
      "rmse_mean": 0.029933948069810867,
      "rotation_flip": 0.009589040651917458,
      "sparse_tokens": 13664.0,
      "step": 2360,
      "turn_loss": 0.2513182759284973,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.10969150715480394,
      "grad_norm": 0.9050907492637634,
      "learning_rate": 9.148143045440181e-06,
      "loss": 0.2916,
      "mae_dtheta": 0.03382285311818123,
      "mae_dx": 0.012980894185602665,
      "mae_dy": 0.006420947145670652,
      "pose_mae_dtheta": 0.2538120448589325,
      "pose_mae_dx": 0.09140200912952423,
      "pose_mae_dy": 0.08250061422586441,
      "pose_rmse_dtheta": 0.42914891242980957,
      "pose_rmse_dx": 0.19413341581821442,
      "pose_rmse_dy": 0.17929698526859283,
      "pose_rmse_mean": 0.26752644777297974,
      "rmse_dtheta": 0.04861738160252571,
      "rmse_dx": 0.0254680085927248,
      "rmse_dy": 0.01097837183624506,
      "rmse_mean": 0.028354588896036148,
      "rotation_flip": 0.015209125354886055,
      "sparse_tokens": 13615.0,
      "step": 2361,
      "turn_loss": 0.3081161379814148,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.10973796692064672,
      "grad_norm": 0.4390561580657959,
      "learning_rate": 9.147404684767632e-06,
      "loss": 0.1251,
      "mae_dtheta": 0.041562050580978394,
      "mae_dx": 0.012792184948921204,
      "mae_dy": 0.005622922908514738,
      "pose_mae_dtheta": 0.32613080739974976,
      "pose_mae_dx": 0.11592510342597961,
      "pose_mae_dy": 0.06059076264500618,
      "pose_rmse_dtheta": 0.5426158308982849,
      "pose_rmse_dx": 0.22752611339092255,
      "pose_rmse_dy": 0.1756746768951416,
      "pose_rmse_mean": 0.3152722120285034,
      "rmse_dtheta": 0.05819544568657875,
      "rmse_dx": 0.023753995075821877,
      "rmse_dy": 0.011895463801920414,
      "rmse_mean": 0.03128163516521454,
      "rotation_flip": 0.01609848439693451,
      "sparse_tokens": 15742.0,
      "step": 2362,
      "turn_loss": 0.306132435798645,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.1097844266864895,
      "grad_norm": 0.5637704730033875,
      "learning_rate": 9.146666034064848e-06,
      "loss": 0.1548,
      "mae_dtheta": 0.03836570680141449,
      "mae_dx": 0.009051679633557796,
      "mae_dy": 0.006714011076837778,
      "pose_mae_dtheta": 0.25201350450515747,
      "pose_mae_dx": 0.08529673516750336,
      "pose_mae_dy": 0.06445526331663132,
      "pose_rmse_dtheta": 0.4760783314704895,
      "pose_rmse_dx": 0.20686765015125275,
      "pose_rmse_dy": 0.12435371428728104,
      "pose_rmse_mean": 0.2690998911857605,
      "rmse_dtheta": 0.05614464357495308,
      "rmse_dx": 0.020458823069930077,
      "rmse_dy": 0.013337526470422745,
      "rmse_mean": 0.029980331659317017,
      "rotation_flip": 0.016990290954709053,
      "sparse_tokens": 6519.0,
      "step": 2363,
      "turn_loss": 0.38870373368263245,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 18773.0,
      "epoch": 0.10983088645233229,
      "grad_norm": 0.5966384410858154,
      "learning_rate": 9.145927093383482e-06,
      "loss": 0.1679,
      "mae_dtheta": 0.0363466776907444,
      "mae_dx": 0.012551394291222095,
      "mae_dy": 0.006540290080010891,
      "pose_mae_dtheta": 0.28762245178222656,
      "pose_mae_dx": 0.10001751780509949,
      "pose_mae_dy": 0.06793905794620514,
      "pose_rmse_dtheta": 0.47723788022994995,
      "pose_rmse_dx": 0.22617556154727936,
      "pose_rmse_dy": 0.14427529275417328,
      "pose_rmse_mean": 0.28256291151046753,
      "rmse_dtheta": 0.05250244215130806,
      "rmse_dx": 0.0245459396392107,
      "rmse_dy": 0.012691815383732319,
      "rmse_mean": 0.0299134012311697,
      "rotation_flip": 0.01785714365541935,
      "sparse_tokens": 15347.0,
      "step": 2364,
      "turn_loss": 0.30633965134620667,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 31695.0,
      "epoch": 0.10987734621817506,
      "grad_norm": 0.5047917366027832,
      "learning_rate": 9.145187862775208e-06,
      "loss": 0.1626,
      "mae_dtheta": 0.042211271822452545,
      "mae_dx": 0.015424372628331184,
      "mae_dy": 0.004394796211272478,
      "pose_mae_dtheta": 0.3549897372722626,
      "pose_mae_dx": 0.12359481304883957,
      "pose_mae_dy": 0.05236678197979927,
      "pose_rmse_dtheta": 0.5751243233680725,
      "pose_rmse_dx": 0.2526809275150299,
      "pose_rmse_dy": 0.12322138994932175,
      "pose_rmse_mean": 0.317008912563324,
      "rmse_dtheta": 0.05863228440284729,
      "rmse_dx": 0.02727419137954712,
      "rmse_dy": 0.0087702926248312,
      "rmse_mean": 0.03155892342329025,
      "rotation_flip": 0.018342390656471252,
      "sparse_tokens": 25230.0,
      "step": 2365,
      "turn_loss": 0.3027030825614929,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.10992380598401784,
      "grad_norm": 0.8530322909355164,
      "learning_rate": 9.144448342291724e-06,
      "loss": 0.272,
      "mae_dtheta": 0.031249048188328743,
      "mae_dx": 0.009260385297238827,
      "mae_dy": 0.006138331722468138,
      "pose_mae_dtheta": 0.2468087524175644,
      "pose_mae_dx": 0.0832795724272728,
      "pose_mae_dy": 0.1005309522151947,
      "pose_rmse_dtheta": 0.4402604103088379,
      "pose_rmse_dx": 0.1781572550535202,
      "pose_rmse_dy": 0.21181148290634155,
      "pose_rmse_mean": 0.2767430543899536,
      "rmse_dtheta": 0.04875091090798378,
      "rmse_dx": 0.02076363004744053,
      "rmse_dy": 0.010683742351830006,
      "rmse_mean": 0.026732763275504112,
      "rotation_flip": 0.00460122711956501,
      "sparse_tokens": 12875.0,
      "step": 2366,
      "turn_loss": 0.264168918132782,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 32018.0,
      "epoch": 0.10997026574986062,
      "grad_norm": 0.4486074149608612,
      "learning_rate": 9.143708531984743e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.03935462236404419,
      "mae_dx": 0.017405495047569275,
      "mae_dy": 0.0058828191831707954,
      "pose_mae_dtheta": 0.3483467400074005,
      "pose_mae_dx": 0.14161807298660278,
      "pose_mae_dy": 0.0747554823756218,
      "pose_rmse_dtheta": 0.5990962386131287,
      "pose_rmse_dx": 0.28613099455833435,
      "pose_rmse_dy": 0.1949918568134308,
      "pose_rmse_mean": 0.3600730299949646,
      "rmse_dtheta": 0.05936814844608307,
      "rmse_dx": 0.030767284333705902,
      "rmse_dy": 0.012996235862374306,
      "rmse_mean": 0.03437722474336624,
      "rotation_flip": 0.009880028665065765,
      "sparse_tokens": 26614.0,
      "step": 2367,
      "turn_loss": 0.25903525948524475,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1100167255157034,
      "grad_norm": 0.5915037989616394,
      "learning_rate": 9.142968431905999e-06,
      "loss": 0.1233,
      "mae_dtheta": 0.00983740296214819,
      "mae_dx": 0.0030053220689296722,
      "mae_dy": 0.002873022109270096,
      "pose_mae_dtheta": 0.0660870224237442,
      "pose_mae_dx": 0.027315642684698105,
      "pose_mae_dy": 0.03644997626543045,
      "pose_rmse_dtheta": 0.12796814739704132,
      "pose_rmse_dx": 0.05600420758128166,
      "pose_rmse_dy": 0.07489165663719177,
      "pose_rmse_mean": 0.08628800511360168,
      "rmse_dtheta": 0.01966908574104309,
      "rmse_dx": 0.007998257875442505,
      "rmse_dy": 0.005588787142187357,
      "rmse_mean": 0.011085378006100655,
      "rotation_flip": 0.005751533899456263,
      "sparse_tokens": 32105.0,
      "step": 2368,
      "turn_loss": 0.12016589194536209,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.11006318528154618,
      "grad_norm": 0.6269677877426147,
      "learning_rate": 9.142228042107248e-06,
      "loss": 0.1778,
      "mae_dtheta": 0.04525218531489372,
      "mae_dx": 0.012961335480213165,
      "mae_dy": 0.00777920288965106,
      "pose_mae_dtheta": 0.375399649143219,
      "pose_mae_dx": 0.11246311664581299,
      "pose_mae_dy": 0.07905888557434082,
      "pose_rmse_dtheta": 0.6022663712501526,
      "pose_rmse_dx": 0.24800747632980347,
      "pose_rmse_dy": 0.1759646236896515,
      "pose_rmse_mean": 0.3420794904232025,
      "rmse_dtheta": 0.0641719400882721,
      "rmse_dx": 0.025005370378494263,
      "rmse_dy": 0.014050631783902645,
      "rmse_mean": 0.03440931439399719,
      "rotation_flip": 0.016897082328796387,
      "sparse_tokens": 10663.0,
      "step": 2369,
      "turn_loss": 0.3353440761566162,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 13282.0,
      "epoch": 0.11010964504738896,
      "grad_norm": 0.5581445693969727,
      "learning_rate": 9.141487362640268e-06,
      "loss": 0.1662,
      "mae_dtheta": 0.045086223632097244,
      "mae_dx": 0.01574786938726902,
      "mae_dy": 0.007769344374537468,
      "pose_mae_dtheta": 0.36632367968559265,
      "pose_mae_dx": 0.09258318692445755,
      "pose_mae_dy": 0.1150035560131073,
      "pose_rmse_dtheta": 0.6387757062911987,
      "pose_rmse_dx": 0.1880692094564438,
      "pose_rmse_dy": 0.2468073070049286,
      "pose_rmse_mean": 0.35788410902023315,
      "rmse_dtheta": 0.06309261173009872,
      "rmse_dx": 0.028599269688129425,
      "rmse_dy": 0.013803434558212757,
      "rmse_mean": 0.03516510874032974,
      "rotation_flip": 0.01088646985590458,
      "sparse_tokens": 11135.0,
      "step": 2370,
      "turn_loss": 0.34830304980278015,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.11015610481323174,
      "grad_norm": 0.4446236789226532,
      "learning_rate": 9.140746393556853e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.05498307943344116,
      "mae_dx": 0.024106496945023537,
      "mae_dy": 0.01124139316380024,
      "pose_mae_dtheta": 0.40604543685913086,
      "pose_mae_dx": 0.18554434180259705,
      "pose_mae_dy": 0.10776398330926895,
      "pose_rmse_dtheta": 0.6539491415023804,
      "pose_rmse_dx": 0.318187952041626,
      "pose_rmse_dy": 0.22335964441299438,
      "pose_rmse_mean": 0.3984989523887634,
      "rmse_dtheta": 0.07182853668928146,
      "rmse_dx": 0.03660222515463829,
      "rmse_dy": 0.020420363172888756,
      "rmse_mean": 0.04295037314295769,
      "rotation_flip": 0.019685039296746254,
      "sparse_tokens": 4028.0,
      "step": 2371,
      "turn_loss": 0.5631168484687805,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 2632.0,
      "epoch": 0.11020256457907453,
      "grad_norm": 0.48940661549568176,
      "learning_rate": 9.140005134908822e-06,
      "loss": 0.1364,
      "mae_dtheta": 0.029979681596159935,
      "mae_dx": 0.01683802902698517,
      "mae_dy": 0.004087039269506931,
      "pose_mae_dtheta": 0.2461157888174057,
      "pose_mae_dx": 0.08814623206853867,
      "pose_mae_dy": 0.040120821446180344,
      "pose_rmse_dtheta": 0.4136655926704407,
      "pose_rmse_dx": 0.17993034422397614,
      "pose_rmse_dy": 0.07988674193620682,
      "pose_rmse_mean": 0.22449421882629395,
      "rmse_dtheta": 0.04578084498643875,
      "rmse_dx": 0.02982831746339798,
      "rmse_dy": 0.00833522155880928,
      "rmse_mean": 0.027981460094451904,
      "rotation_flip": 0.008403361774981022,
      "sparse_tokens": 2254.0,
      "step": 2372,
      "turn_loss": 0.20776918530464172,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1102490243449173,
      "grad_norm": 0.4825887382030487,
      "learning_rate": 9.139263586748011e-06,
      "loss": 0.0888,
      "mae_dtheta": 0.010742624290287495,
      "mae_dx": 0.001409062184393406,
      "mae_dy": 0.0022271438501775265,
      "pose_mae_dtheta": 0.0772852972149849,
      "pose_mae_dx": 0.022410687059164047,
      "pose_mae_dy": 0.03408494219183922,
      "pose_rmse_dtheta": 0.16545653343200684,
      "pose_rmse_dx": 0.05059787258505821,
      "pose_rmse_dy": 0.08085467666387558,
      "pose_rmse_mean": 0.09896969795227051,
      "rmse_dtheta": 0.02117190510034561,
      "rmse_dx": 0.004267983604222536,
      "rmse_dy": 0.004146174062043428,
      "rmse_mean": 0.009862020611763,
      "rotation_flip": 0.0033333334140479565,
      "sparse_tokens": 32073.0,
      "step": 2373,
      "turn_loss": 0.07181134074926376,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11029548411076008,
      "grad_norm": 0.41060590744018555,
      "learning_rate": 9.138521749126272e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.008712812326848507,
      "mae_dx": 0.001989219104871154,
      "mae_dy": 0.0019867923110723495,
      "pose_mae_dtheta": 0.05904587358236313,
      "pose_mae_dx": 0.022045576944947243,
      "pose_mae_dy": 0.025010013952851295,
      "pose_rmse_dtheta": 0.1460648626089096,
      "pose_rmse_dx": 0.049368392676115036,
      "pose_rmse_dy": 0.05755799636244774,
      "pose_rmse_mean": 0.08433042466640472,
      "rmse_dtheta": 0.019771842285990715,
      "rmse_dx": 0.005356667563319206,
      "rmse_dy": 0.004176517482846975,
      "rmse_mean": 0.009768342599272728,
      "rotation_flip": 0.0048250905238091946,
      "sparse_tokens": 32121.0,
      "step": 2374,
      "turn_loss": 0.07133528590202332,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.11034194387660286,
      "grad_norm": 0.3966788649559021,
      "learning_rate": 9.137779622095488e-06,
      "loss": 0.0853,
      "mae_dtheta": 0.008430557325482368,
      "mae_dx": 0.00169289275072515,
      "mae_dy": 0.0021371778566390276,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3966788053512573,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.3263702392578,
      "model/head/act_norm_mean": 116.07068734217172,
      "model/head/act_norm_min": 65.839599609375,
      "model/head/act_over_embed": 79.76486301243608,
      "model/head/grad_frac": 0.11230538785457611,
      "model/head/grad_norm": 0.04454916715621948,
      "model/head/grad_zero_frac": 0.00017830674187280238,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6913914535984849,
      "model/head/update_ratio": 0.0007712088408879936,
      "model/head/weight_delta": 5.616508960723877,
      "model/head/weight_delta_rel": 0.09853020310401917,
      "model/head/weight_norm": 57.76537322998047,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.415069043636322,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4150059669529466,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41493287682533264,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2851959858371422,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09122102707624435,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03618544712662697,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5185145547945206,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011755675077438354,
      "model/modality_embedder.encoders.pose/weight_delta": 1.824754238128662,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.05962040647864342,
      "model/modality_embedder.encoders.pose/weight_norm": 30.78125762939453,
      "model/modality_embedder/grad_frac": 0.09122102707624435,
      "model/modality_embedder/grad_norm": 0.03618544712662697,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5185145547945206,
      "model/modality_embedder/update_ratio": 0.0011755675077438354,
      "model/modality_embedder/weight_delta": 1.824754238128662,
      "model/modality_embedder/weight_delta_rel": 0.05962040647864342,
      "model/modality_embedder/weight_norm": 30.78125762939453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.42938232421875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.037968975468974,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.961745262145996,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.519117326953502,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0899527370929718,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03568234294652939,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012913196114823222,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.1601229906082153,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04227558150887489,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.632465362548828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.716552734375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.135283890492225,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.232244491577148,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.27320240978157,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08463554829359055,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.033573128283023834,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011492370394989848,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.4521198272705078,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05030256509780884,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.21340560913086,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.52576446533203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.069887866762866,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.0692720413208,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.602680374322542,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08934441953897476,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03544103726744652,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001175436656922102,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.5516942739486694,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.052102986723184586,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.151378631591797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.07328796386719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.90468674843675,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.92791748046875,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.863571343466603,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12202935665845871,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.048406459391117096,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001639446709305048,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.3246428966522217,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.045270007103681564,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.526094436645508,
      "model/normalizer/grad_frac": 0.4089321792125702,
      "model/normalizer/grad_norm": 0.1622147262096405,
      "model/normalizer/grad_zero_frac": 0.00017607901827432215,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020788435358554125,
      "model/normalizer/weight_delta": 2.826425075531006,
      "model/normalizer/weight_delta_rel": 0.03640271723270416,
      "model/normalizer/weight_norm": 78.03123474121094,
      "pose_mae_dtheta": 0.06023219972848892,
      "pose_mae_dx": 0.023037444800138474,
      "pose_mae_dy": 0.0284636951982975,
      "pose_rmse_dtheta": 0.14891383051872253,
      "pose_rmse_dx": 0.058648187667131424,
      "pose_rmse_dy": 0.07683796435594559,
      "pose_rmse_mean": 0.09479999542236328,
      "rmse_dtheta": 0.019725192338228226,
      "rmse_dx": 0.004872104153037071,
      "rmse_dy": 0.004960054066032171,
      "rmse_mean": 0.009852450340986252,
      "rotation_flip": 0.0017605633474886417,
      "sparse_tokens": 32073.0,
      "step": 2375,
      "turn_loss": 0.07096931338310242,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 40762.0,
      "epoch": 0.11038840364244565,
      "grad_norm": 0.6717575192451477,
      "learning_rate": 9.137037205707552e-06,
      "loss": 0.1735,
      "mae_dtheta": 0.041020240634679794,
      "mae_dx": 0.0129774184897542,
      "mae_dy": 0.004219177644699812,
      "pose_mae_dtheta": 0.34776851534843445,
      "pose_mae_dx": 0.10098139196634293,
      "pose_mae_dy": 0.05288747698068619,
      "pose_rmse_dtheta": 0.590776801109314,
      "pose_rmse_dx": 0.21519112586975098,
      "pose_rmse_dy": 0.12023413181304932,
      "pose_rmse_mean": 0.3087340295314789,
      "rmse_dtheta": 0.06007722020149231,
      "rmse_dx": 0.024854548275470734,
      "rmse_dy": 0.007985745556652546,
      "rmse_mean": 0.03097250685095787,
      "rotation_flip": 0.02057814784348011,
      "sparse_tokens": 29962.0,
      "step": 2376,
      "turn_loss": 0.2770428955554962,
      "turns": 126.0,
      "turns_per_sample": 126.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11043486340828843,
      "grad_norm": 0.5297342538833618,
      "learning_rate": 9.136294500014387e-06,
      "loss": 0.079,
      "mae_dtheta": 0.008473340421915054,
      "mae_dx": 0.0024485525209456682,
      "mae_dy": 0.0018093310063704848,
      "pose_mae_dtheta": 0.06067720428109169,
      "pose_mae_dx": 0.0247627142816782,
      "pose_mae_dy": 0.01928301528096199,
      "pose_rmse_dtheta": 0.16269659996032715,
      "pose_rmse_dx": 0.06570439040660858,
      "pose_rmse_dy": 0.04383709281682968,
      "pose_rmse_mean": 0.09074603021144867,
      "rmse_dtheta": 0.020778773352503777,
      "rmse_dx": 0.007659904658794403,
      "rmse_dy": 0.00423366529867053,
      "rmse_mean": 0.010890780948102474,
      "rotation_flip": 0.005757052451372147,
      "sparse_tokens": 32089.0,
      "step": 2377,
      "turn_loss": 0.07362975180149078,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15543.0,
      "epoch": 0.1104813231741312,
      "grad_norm": 0.696074903011322,
      "learning_rate": 9.135551505067925e-06,
      "loss": 0.1864,
      "mae_dtheta": 0.03812307119369507,
      "mae_dx": 0.014517567120492458,
      "mae_dy": 0.009853813797235489,
      "pose_mae_dtheta": 0.305866003036499,
      "pose_mae_dx": 0.1304049789905548,
      "pose_mae_dy": 0.10756814479827881,
      "pose_rmse_dtheta": 0.5354993939399719,
      "pose_rmse_dx": 0.2679864764213562,
      "pose_rmse_dy": 0.24810700118541718,
      "pose_rmse_mean": 0.3505309522151947,
      "rmse_dtheta": 0.057225894182920456,
      "rmse_dx": 0.026598889380693436,
      "rmse_dy": 0.021017493680119514,
      "rmse_mean": 0.03494742512702942,
      "rotation_flip": 0.006088280119001865,
      "sparse_tokens": 11860.0,
      "step": 2378,
      "turn_loss": 0.38083362579345703,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11052778293997398,
      "grad_norm": 0.43915125727653503,
      "learning_rate": 9.134808220920128e-06,
      "loss": 0.0919,
      "mae_dtheta": 0.009100757539272308,
      "mae_dx": 0.001912937150336802,
      "mae_dy": 0.0022595510818064213,
      "pose_mae_dtheta": 0.06335394084453583,
      "pose_mae_dx": 0.025519711896777153,
      "pose_mae_dy": 0.02798212505877018,
      "pose_rmse_dtheta": 0.1413722187280655,
      "pose_rmse_dx": 0.07960792630910873,
      "pose_rmse_dy": 0.06549826264381409,
      "pose_rmse_mean": 0.09549280256032944,
      "rmse_dtheta": 0.018495559692382812,
      "rmse_dx": 0.0067370301112532616,
      "rmse_dy": 0.005900133401155472,
      "rmse_mean": 0.01037757471203804,
      "rotation_flip": 0.0016220599645748734,
      "sparse_tokens": 32105.0,
      "step": 2379,
      "turn_loss": 0.08420509099960327,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11057424270581677,
      "grad_norm": 0.34852081537246704,
      "learning_rate": 9.134064647622973e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.009813366457819939,
      "mae_dx": 0.0017591266660019755,
      "mae_dy": 0.002025799360126257,
      "pose_mae_dtheta": 0.06701689213514328,
      "pose_mae_dx": 0.01571119949221611,
      "pose_mae_dy": 0.02401040308177471,
      "pose_rmse_dtheta": 0.1736239492893219,
      "pose_rmse_dx": 0.037727922201156616,
      "pose_rmse_dy": 0.05653917044401169,
      "pose_rmse_mean": 0.08929701894521713,
      "rmse_dtheta": 0.02298855595290661,
      "rmse_dx": 0.006219357717782259,
      "rmse_dy": 0.005510489456355572,
      "rmse_mean": 0.011572800576686859,
      "rotation_flip": 0.003746721660718322,
      "sparse_tokens": 32137.0,
      "step": 2380,
      "turn_loss": 0.08016179502010345,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.11062070247165955,
      "grad_norm": 0.7155888080596924,
      "learning_rate": 9.133320785228457e-06,
      "loss": 0.2259,
      "mae_dtheta": 0.038608189672231674,
      "mae_dx": 0.014077157713472843,
      "mae_dy": 0.007182454224675894,
      "pose_mae_dtheta": 0.31056421995162964,
      "pose_mae_dx": 0.10657594352960587,
      "pose_mae_dy": 0.07797670364379883,
      "pose_rmse_dtheta": 0.5142903327941895,
      "pose_rmse_dx": 0.2369072139263153,
      "pose_rmse_dy": 0.19610391557216644,
      "pose_rmse_mean": 0.31576716899871826,
      "rmse_dtheta": 0.05662212148308754,
      "rmse_dx": 0.026709288358688354,
      "rmse_dy": 0.016072718426585197,
      "rmse_mean": 0.03313471004366875,
      "rotation_flip": 0.011248594149947166,
      "sparse_tokens": 14470.0,
      "step": 2381,
      "turn_loss": 0.3284304738044739,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 33738.0,
      "epoch": 0.11066716223750232,
      "grad_norm": 0.48653095960617065,
      "learning_rate": 9.1325766337886e-06,
      "loss": 0.1326,
      "mae_dtheta": 0.030733762308955193,
      "mae_dx": 0.011194185353815556,
      "mae_dy": 0.005139241926372051,
      "pose_mae_dtheta": 0.24272598326206207,
      "pose_mae_dx": 0.09343525022268295,
      "pose_mae_dy": 0.059014350175857544,
      "pose_rmse_dtheta": 0.42816492915153503,
      "pose_rmse_dx": 0.19831986725330353,
      "pose_rmse_dy": 0.13476629555225372,
      "pose_rmse_mean": 0.25375038385391235,
      "rmse_dtheta": 0.04751930385828018,
      "rmse_dx": 0.022404305636882782,
      "rmse_dy": 0.0104834521189332,
      "rmse_mean": 0.02680235356092453,
      "rotation_flip": 0.01874244213104248,
      "sparse_tokens": 26711.0,
      "step": 2382,
      "turn_loss": 0.2680436074733734,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.1107136220033451,
      "grad_norm": 0.829321026802063,
      "learning_rate": 9.13183219335544e-06,
      "loss": 0.1809,
      "mae_dtheta": 0.03867971524596214,
      "mae_dx": 0.008787206374108791,
      "mae_dy": 0.015494558028876781,
      "pose_mae_dtheta": 0.2849804759025574,
      "pose_mae_dx": 0.0919010117650032,
      "pose_mae_dy": 0.16967305541038513,
      "pose_rmse_dtheta": 0.5072248578071594,
      "pose_rmse_dx": 0.18966548144817352,
      "pose_rmse_dy": 0.3270212709903717,
      "pose_rmse_mean": 0.34130388498306274,
      "rmse_dtheta": 0.057050738483667374,
      "rmse_dx": 0.02030927501618862,
      "rmse_dy": 0.02766692079603672,
      "rmse_mean": 0.035008978098630905,
      "rotation_flip": 0.016620498150587082,
      "sparse_tokens": 6991.0,
      "step": 2383,
      "turn_loss": 0.4590803384780884,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.11076008176918788,
      "grad_norm": 0.5185624361038208,
      "learning_rate": 9.131087463981039e-06,
      "loss": 0.1575,
      "mae_dtheta": 0.03022356890141964,
      "mae_dx": 0.01041566114872694,
      "mae_dy": 0.0056176078505814075,
      "pose_mae_dtheta": 0.24331670999526978,
      "pose_mae_dx": 0.07380390912294388,
      "pose_mae_dy": 0.09319816529750824,
      "pose_rmse_dtheta": 0.49237239360809326,
      "pose_rmse_dx": 0.16116280853748322,
      "pose_rmse_dy": 0.19443880021572113,
      "pose_rmse_mean": 0.28265801072120667,
      "rmse_dtheta": 0.048690445721149445,
      "rmse_dx": 0.022997606545686722,
      "rmse_dy": 0.009585713967680931,
      "rmse_mean": 0.02709125727415085,
      "rotation_flip": 0.007462686393409967,
      "sparse_tokens": 7003.0,
      "step": 2384,
      "turn_loss": 0.2408026158809662,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11080654153503067,
      "grad_norm": 0.6290856599807739,
      "learning_rate": 9.130342445717474e-06,
      "loss": 0.1613,
      "mae_dtheta": 0.01265843864530325,
      "mae_dx": 0.002029322786256671,
      "mae_dy": 0.002659838879480958,
      "pose_mae_dtheta": 0.09857022017240524,
      "pose_mae_dx": 0.028350478038191795,
      "pose_mae_dy": 0.038982875645160675,
      "pose_rmse_dtheta": 0.22550605237483978,
      "pose_rmse_dx": 0.06859129667282104,
      "pose_rmse_dy": 0.09274420887231827,
      "pose_rmse_mean": 0.1289471983909607,
      "rmse_dtheta": 0.026332730427384377,
      "rmse_dx": 0.005939504597336054,
      "rmse_dy": 0.005671252496540546,
      "rmse_mean": 0.01264782901853323,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 32105.0,
      "step": 2385,
      "turn_loss": 0.0956662967801094,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.11085300130087344,
      "grad_norm": 0.4726906418800354,
      "learning_rate": 9.129597138616845e-06,
      "loss": 0.1618,
      "mae_dtheta": 0.010823192074894905,
      "mae_dx": 0.0019160645315423608,
      "mae_dy": 0.002048824680969119,
      "pose_mae_dtheta": 0.07431431114673615,
      "pose_mae_dx": 0.02480025216937065,
      "pose_mae_dy": 0.029483377933502197,
      "pose_rmse_dtheta": 0.1978893131017685,
      "pose_rmse_dx": 0.08846526592969894,
      "pose_rmse_dy": 0.07154104113578796,
      "pose_rmse_mean": 0.1192985400557518,
      "rmse_dtheta": 0.023816442117094994,
      "rmse_dx": 0.007799566723406315,
      "rmse_dy": 0.004728259053081274,
      "rmse_mean": 0.012114755809307098,
      "rotation_flip": 0.003547896631062031,
      "sparse_tokens": 32025.0,
      "step": 2386,
      "turn_loss": 0.0812947228550911,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64681.0,
      "epoch": 0.11089946106671622,
      "grad_norm": 0.3758280575275421,
      "learning_rate": 9.128851542731271e-06,
      "loss": 0.0984,
      "mae_dtheta": 0.01182747632265091,
      "mae_dx": 0.0025761860888451338,
      "mae_dy": 0.0003673647588584572,
      "pose_mae_dtheta": 0.08713851869106293,
      "pose_mae_dx": 0.01959404908120632,
      "pose_mae_dy": 0.005226086359471083,
      "pose_rmse_dtheta": 0.29360952973365784,
      "pose_rmse_dx": 0.043509550392627716,
      "pose_rmse_dy": 0.010254094377160072,
      "pose_rmse_mean": 0.11579105257987976,
      "rmse_dtheta": 0.0353652648627758,
      "rmse_dx": 0.006257406435906887,
      "rmse_dy": 0.0007209061295725405,
      "rmse_mean": 0.01411452703177929,
      "rotation_flip": 0.0020429010037332773,
      "sparse_tokens": 32281.0,
      "step": 2387,
      "turn_loss": 0.06921777874231339,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.110945920832559,
      "grad_norm": 0.5448005795478821,
      "learning_rate": 9.128105658112894e-06,
      "loss": 0.1002,
      "mae_dtheta": 0.010324872098863125,
      "mae_dx": 0.0017716563306748867,
      "mae_dy": 0.002028936054557562,
      "pose_mae_dtheta": 0.06873137503862381,
      "pose_mae_dx": 0.022719072178006172,
      "pose_mae_dy": 0.026698848232626915,
      "pose_rmse_dtheta": 0.18122002482414246,
      "pose_rmse_dx": 0.06666003912687302,
      "pose_rmse_dy": 0.0663665309548378,
      "pose_rmse_mean": 0.10474886745214462,
      "rmse_dtheta": 0.02341008000075817,
      "rmse_dx": 0.006507403217256069,
      "rmse_dy": 0.004665883257985115,
      "rmse_mean": 0.011527789756655693,
      "rotation_flip": 0.009186351671814919,
      "sparse_tokens": 32105.0,
      "step": 2388,
      "turn_loss": 0.0782967060804367,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21680.0,
      "epoch": 0.11099238059840179,
      "grad_norm": 0.48226308822631836,
      "learning_rate": 9.12735948481387e-06,
      "loss": 0.1776,
      "mae_dtheta": 0.03357800841331482,
      "mae_dx": 0.01116738561540842,
      "mae_dy": 0.005866893567144871,
      "pose_mae_dtheta": 0.27778705954551697,
      "pose_mae_dx": 0.09273713827133179,
      "pose_mae_dy": 0.0758531466126442,
      "pose_rmse_dtheta": 0.49828770756721497,
      "pose_rmse_dx": 0.19574807584285736,
      "pose_rmse_dy": 0.15519656240940094,
      "pose_rmse_mean": 0.2830774486064911,
      "rmse_dtheta": 0.051633320748806,
      "rmse_dx": 0.023393962532281876,
      "rmse_dy": 0.01066275592893362,
      "rmse_mean": 0.028563348576426506,
      "rotation_flip": 0.017259977757930756,
      "sparse_tokens": 18003.0,
      "step": 2389,
      "turn_loss": 0.27176666259765625,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 11055.0,
      "epoch": 0.11103884036424456,
      "grad_norm": 0.4266532361507416,
      "learning_rate": 9.126613022886384e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.018712906166911125,
      "mae_dx": 0.012099510058760643,
      "mae_dy": 0.003010805230587721,
      "pose_mae_dtheta": 0.12714466452598572,
      "pose_mae_dx": 0.08913608640432358,
      "pose_mae_dy": 0.038241028785705566,
      "pose_rmse_dtheta": 0.258895605802536,
      "pose_rmse_dx": 0.2158990055322647,
      "pose_rmse_dy": 0.10254166275262833,
      "pose_rmse_mean": 0.19244544208049774,
      "rmse_dtheta": 0.033840522170066833,
      "rmse_dx": 0.026303470134735107,
      "rmse_dy": 0.0067948102951049805,
      "rmse_mean": 0.022312935441732407,
      "rotation_flip": 0.012077294290065765,
      "sparse_tokens": 8673.0,
      "step": 2390,
      "turn_loss": 0.20919863879680634,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.11108530013008734,
      "grad_norm": 0.4085622727870941,
      "learning_rate": 9.125866272382633e-06,
      "loss": 0.164,
      "mae_dtheta": 0.00840800255537033,
      "mae_dx": 0.0019445318030193448,
      "mae_dy": 0.0015471057267859578,
      "pose_mae_dtheta": 0.05715716630220413,
      "pose_mae_dx": 0.022641539573669434,
      "pose_mae_dy": 0.022377774119377136,
      "pose_rmse_dtheta": 0.13948719203472137,
      "pose_rmse_dx": 0.06352933496236801,
      "pose_rmse_dy": 0.05806301161646843,
      "pose_rmse_mean": 0.08702650666236877,
      "rmse_dtheta": 0.02096356451511383,
      "rmse_dx": 0.006548880133777857,
      "rmse_dy": 0.003492235904559493,
      "rmse_mean": 0.010334894061088562,
      "rotation_flip": 0.0022321429569274187,
      "sparse_tokens": 32153.0,
      "step": 2391,
      "turn_loss": 0.06465137004852295,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11113175989593012,
      "grad_norm": 0.4217755198478699,
      "learning_rate": 9.12511923335484e-06,
      "loss": 0.122,
      "mae_dtheta": 0.00831640139222145,
      "mae_dx": 0.0016357814893126488,
      "mae_dy": 0.001450953888706863,
      "pose_mae_dtheta": 0.05422599986195564,
      "pose_mae_dx": 0.01670319214463234,
      "pose_mae_dy": 0.02015763521194458,
      "pose_rmse_dtheta": 0.14489077031612396,
      "pose_rmse_dx": 0.04541302099823952,
      "pose_rmse_dy": 0.05203162133693695,
      "pose_rmse_mean": 0.08077847212553024,
      "rmse_dtheta": 0.02102997712790966,
      "rmse_dx": 0.0049866316840052605,
      "rmse_dy": 0.00353059871122241,
      "rmse_mean": 0.009849069640040398,
      "rotation_flip": 0.002377555938437581,
      "sparse_tokens": 32121.0,
      "step": 2392,
      "turn_loss": 0.0640534907579422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.11117821966177291,
      "grad_norm": 0.5430493354797363,
      "learning_rate": 9.124371905855244e-06,
      "loss": 0.1662,
      "mae_dtheta": 0.033726755529642105,
      "mae_dx": 0.011290217749774456,
      "mae_dy": 0.004623644053936005,
      "pose_mae_dtheta": 0.27530014514923096,
      "pose_mae_dx": 0.09929995238780975,
      "pose_mae_dy": 0.07516387850046158,
      "pose_rmse_dtheta": 0.5657162070274353,
      "pose_rmse_dx": 0.18869346380233765,
      "pose_rmse_dy": 0.14514382183551788,
      "pose_rmse_mean": 0.2998511791229248,
      "rmse_dtheta": 0.053810808807611465,
      "rmse_dx": 0.02114681527018547,
      "rmse_dy": 0.007769640535116196,
      "rmse_mean": 0.02757575735449791,
      "rotation_flip": 0.012461058795452118,
      "sparse_tokens": 5691.0,
      "step": 2393,
      "turn_loss": 0.2306387573480606,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.11122467942761569,
      "grad_norm": 0.5358297228813171,
      "learning_rate": 9.123624289936107e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.036999866366386414,
      "mae_dx": 0.014501914381980896,
      "mae_dy": 0.004985013976693153,
      "pose_mae_dtheta": 0.2964631915092468,
      "pose_mae_dx": 0.1139700636267662,
      "pose_mae_dy": 0.05497390404343605,
      "pose_rmse_dtheta": 0.49817997217178345,
      "pose_rmse_dx": 0.2591952085494995,
      "pose_rmse_dy": 0.12745894491672516,
      "pose_rmse_mean": 0.294944703578949,
      "rmse_dtheta": 0.05387832969427109,
      "rmse_dx": 0.027810113504529,
      "rmse_dy": 0.009025954641401768,
      "rmse_mean": 0.030238132923841476,
      "rotation_flip": 0.011264080181717873,
      "sparse_tokens": 13890.0,
      "step": 2394,
      "turn_loss": 0.24370934069156647,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.11127113919345846,
      "grad_norm": 1.0960607528686523,
      "learning_rate": 9.122876385649713e-06,
      "loss": 0.2859,
      "mae_dtheta": 0.029286766424775124,
      "mae_dx": 0.01138573233038187,
      "mae_dy": 0.003972640261054039,
      "pose_mae_dtheta": 0.2445497363805771,
      "pose_mae_dx": 0.07944382727146149,
      "pose_mae_dy": 0.04895346611738205,
      "pose_rmse_dtheta": 0.46321940422058105,
      "pose_rmse_dx": 0.18034467101097107,
      "pose_rmse_dy": 0.11123831570148468,
      "pose_rmse_mean": 0.25160080194473267,
      "rmse_dtheta": 0.04752005636692047,
      "rmse_dx": 0.02281659096479416,
      "rmse_dy": 0.008949215523898602,
      "rmse_mean": 0.026428621262311935,
      "rotation_flip": 0.018237082287669182,
      "sparse_tokens": 11370.0,
      "step": 2395,
      "turn_loss": 0.2597014605998993,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11131759895930124,
      "grad_norm": 0.38879457116127014,
      "learning_rate": 9.122128193048358e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.01254836842417717,
      "mae_dx": 0.0017779412446543574,
      "mae_dy": 0.0030388005543500185,
      "pose_mae_dtheta": 0.0766526460647583,
      "pose_mae_dx": 0.023070715367794037,
      "pose_mae_dy": 0.036984946578741074,
      "pose_rmse_dtheta": 0.153121218085289,
      "pose_rmse_dx": 0.056544527411460876,
      "pose_rmse_dy": 0.07988766580820084,
      "pose_rmse_mean": 0.09651780128479004,
      "rmse_dtheta": 0.022556232288479805,
      "rmse_dx": 0.00546407513320446,
      "rmse_dy": 0.005509581416845322,
      "rmse_mean": 0.011176629923284054,
      "rotation_flip": 0.006864988710731268,
      "sparse_tokens": 32105.0,
      "step": 2396,
      "turn_loss": 0.09612000733613968,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.11136405872514403,
      "grad_norm": 0.5024599432945251,
      "learning_rate": 9.121379712184367e-06,
      "loss": 0.098,
      "mae_dtheta": 0.00532499561086297,
      "mae_dx": 0.0016844791825860739,
      "mae_dy": 0.0018022560980170965,
      "pose_mae_dtheta": 0.038852665573358536,
      "pose_mae_dx": 0.021664880216121674,
      "pose_mae_dy": 0.019141459837555885,
      "pose_rmse_dtheta": 0.09969386458396912,
      "pose_rmse_dx": 0.05862972512841225,
      "pose_rmse_dy": 0.05379071459174156,
      "pose_rmse_mean": 0.07070477306842804,
      "rmse_dtheta": 0.014362202025949955,
      "rmse_dx": 0.004950253292918205,
      "rmse_dy": 0.005095799453556538,
      "rmse_mean": 0.008136085234582424,
      "rotation_flip": 0.0029886432457715273,
      "sparse_tokens": 32073.0,
      "step": 2397,
      "turn_loss": 0.05179854482412338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1114105184909868,
      "grad_norm": 0.3785771131515503,
      "learning_rate": 9.120630943110078e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.013220909051597118,
      "mae_dx": 0.003521916689351201,
      "mae_dy": 0.004221353679895401,
      "pose_mae_dtheta": 0.09948965907096863,
      "pose_mae_dx": 0.03963273763656616,
      "pose_mae_dy": 0.03552136942744255,
      "pose_rmse_dtheta": 0.2225959300994873,
      "pose_rmse_dx": 0.10742738097906113,
      "pose_rmse_dy": 0.07881754636764526,
      "pose_rmse_mean": 0.13628029823303223,
      "rmse_dtheta": 0.0268857441842556,
      "rmse_dx": 0.009148305281996727,
      "rmse_dy": 0.009546718560159206,
      "rmse_mean": 0.01519358903169632,
      "rotation_flip": 0.0063402606174349785,
      "sparse_tokens": 32137.0,
      "step": 2398,
      "turn_loss": 0.12569749355316162,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.11145697825682958,
      "grad_norm": 0.842386782169342,
      "learning_rate": 9.119881885877858e-06,
      "loss": 0.2691,
      "mae_dtheta": 0.018997782841324806,
      "mae_dx": 0.008121884427964687,
      "mae_dy": 0.003951932769268751,
      "pose_mae_dtheta": 0.14614559710025787,
      "pose_mae_dx": 0.06098735332489014,
      "pose_mae_dy": 0.06136518344283104,
      "pose_rmse_dtheta": 0.2260102778673172,
      "pose_rmse_dx": 0.1386207640171051,
      "pose_rmse_dy": 0.12283380329608917,
      "pose_rmse_mean": 0.16248828172683716,
      "rmse_dtheta": 0.03111204504966736,
      "rmse_dx": 0.019025152549147606,
      "rmse_dy": 0.006849383935332298,
      "rmse_mean": 0.018995529040694237,
      "rotation_flip": 0.01711491495370865,
      "sparse_tokens": 7749.0,
      "step": 2399,
      "turn_loss": 0.14362914860248566,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11150343802267236,
      "grad_norm": 0.4806540608406067,
      "learning_rate": 9.119132540540086e-06,
      "loss": 0.1134,
      "mae_dtheta": 0.01522061787545681,
      "mae_dx": 0.0032031345181167126,
      "mae_dy": 0.0048949685879051685,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.48065391182899475,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.81985473632812,
      "model/head/act_norm_mean": 105.96397569444444,
      "model/head/act_norm_min": 59.65707015991211,
      "model/head/act_over_embed": 72.81943614759268,
      "model/head/grad_frac": 0.10300861299037933,
      "model/head/grad_norm": 0.049511492252349854,
      "model/head/grad_zero_frac": 0.00020813028095290065,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.692742858270202,
      "model/head/update_ratio": 0.0008570129866711795,
      "model/head/weight_delta": 5.651030540466309,
      "model/head/weight_delta_rel": 0.09913581609725952,
      "model/head/weight_norm": 57.772159576416016,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41516032814979553,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.415080938638593,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41500598192214966,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2852475070814144,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08630473166704178,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04148270562291145,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5400259248878924,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013476081658154726,
      "model/modality_embedder.encoders.pose/weight_delta": 1.8348536491394043,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.059950388967990875,
      "model/modality_embedder.encoders.pose/weight_norm": 30.782468795776367,
      "model/modality_embedder/grad_frac": 0.08630473166704178,
      "model/modality_embedder/grad_norm": 0.04148270562291145,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5400259248878924,
      "model/modality_embedder/update_ratio": 0.0013476081658154726,
      "model/modality_embedder/weight_delta": 1.8348536491394043,
      "model/modality_embedder/weight_delta_rel": 0.059950388967990875,
      "model/modality_embedder/weight_norm": 30.782468795776367,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.06752014160156,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.079016855058523,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.949938774108887,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.86011645195624,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08040584623813629,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03864738345146179,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013985497644171119,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.170414924621582,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.042650625109672546,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.633899688720703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.7217788696289,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.1401765672599,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.261504173278809,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.589355340914775,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08178895711898804,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03931218385696411,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013455207226797938,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.464697241783142,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05073825642466545,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.217079162597656,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.7119140625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.10522887606221,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.501827239990234,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.93975768463329,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08712437003850937,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.041876669973134995,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013886732049286366,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.5657191276550293,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05257391557097435,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.155885696411133,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.70584869384766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.047629068462403,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.212275505065918,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.274593281887814,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10835085064172745,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05207926034927368,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017637150594964623,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.3352168798446655,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.045631375163793564,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.528160095214844,
      "model/normalizer/grad_frac": 0.42761775851249695,
      "model/normalizer/grad_norm": 0.2055361419916153,
      "model/normalizer/grad_zero_frac": 0.0001689885975793004,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0026338929310441017,
      "model/normalizer/weight_delta": 2.8507375717163086,
      "model/normalizer/weight_delta_rel": 0.03671585023403168,
      "model/normalizer/weight_norm": 78.03511810302734,
      "pose_mae_dtheta": 0.10300843417644501,
      "pose_mae_dx": 0.04303073137998581,
      "pose_mae_dy": 0.04807635769248009,
      "pose_rmse_dtheta": 0.21877606213092804,
      "pose_rmse_dx": 0.10227318853139877,
      "pose_rmse_dy": 0.09744008630514145,
      "pose_rmse_mean": 0.13949644565582275,
      "rmse_dtheta": 0.027361758053302765,
      "rmse_dx": 0.008028712123632431,
      "rmse_dy": 0.009807238355278969,
      "rmse_mean": 0.015065903775393963,
      "rotation_flip": 0.006103763822466135,
      "sparse_tokens": 32105.0,
      "step": 2400,
      "turn_loss": 0.13800930976867676,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.11150343802267236,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3197333514690399,
      "eval_objectnav_nopose_mae_dtheta": 0.041281331330537796,
      "eval_objectnav_nopose_mae_dx": 0.01378553081303835,
      "eval_objectnav_nopose_mae_dy": 0.005054965615272522,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3412506878376007,
      "eval_objectnav_nopose_pose_mae_dx": 0.11207162588834763,
      "eval_objectnav_nopose_pose_mae_dy": 0.05720743164420128,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5670058131217957,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24149736762046814,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13587377965450287,
      "eval_objectnav_nopose_pose_rmse_mean": 0.31479233503341675,
      "eval_objectnav_nopose_rmse_dtheta": 0.059322699904441833,
      "eval_objectnav_nopose_rmse_dx": 0.02661297470331192,
      "eval_objectnav_nopose_rmse_dy": 0.010414623655378819,
      "eval_objectnav_nopose_rmse_mean": 0.03211676701903343,
      "eval_objectnav_nopose_rotation_flip": 0.01466247159987688,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3197333514690399,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 2400
    },
    {
      "epoch": 0.11150343802267236,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.29070159792900085,
      "eval_objectnav_pose_mae_dtheta": 0.03719358146190643,
      "eval_objectnav_pose_mae_dx": 0.011889178305864334,
      "eval_objectnav_pose_mae_dy": 0.004713761154562235,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2876196503639221,
      "eval_objectnav_pose_pose_mae_dx": 0.09527342021465302,
      "eval_objectnav_pose_pose_mae_dy": 0.05164230614900589,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5007767677307129,
      "eval_objectnav_pose_pose_rmse_dx": 0.21813152730464935,
      "eval_objectnav_pose_pose_rmse_dy": 0.12540332973003387,
      "eval_objectnav_pose_pose_rmse_mean": 0.2814372181892395,
      "eval_objectnav_pose_rmse_dtheta": 0.05521737039089203,
      "eval_objectnav_pose_rmse_dx": 0.02437758445739746,
      "eval_objectnav_pose_rmse_dy": 0.009908725507557392,
      "eval_objectnav_pose_rmse_mean": 0.029834561049938202,
      "eval_objectnav_pose_rotation_flip": 0.015102877281606197,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.29070159792900085,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 2400
    },
    {
      "epoch": 0.11150343802267236,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10443141311407089,
      "eval_pointnav_mae_dtheta": 0.011763214133679867,
      "eval_pointnav_mae_dx": 0.0029386242385953665,
      "eval_pointnav_mae_dy": 0.002779754577204585,
      "eval_pointnav_pose_mae_dtheta": 0.08412906527519226,
      "eval_pointnav_pose_mae_dx": 0.03246541693806648,
      "eval_pointnav_pose_mae_dy": 0.03122520074248314,
      "eval_pointnav_pose_rmse_dtheta": 0.22897154092788696,
      "eval_pointnav_pose_rmse_dx": 0.09348829835653305,
      "eval_pointnav_pose_rmse_dy": 0.08586803823709488,
      "eval_pointnav_pose_rmse_mean": 0.13610929250717163,
      "eval_pointnav_rmse_dtheta": 0.027595294639468193,
      "eval_pointnav_rmse_dx": 0.008792063221335411,
      "eval_pointnav_rmse_dy": 0.007103801239281893,
      "eval_pointnav_rmse_mean": 0.014497052878141403,
      "eval_pointnav_rotation_flip": 0.004874651785939932,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10443141311407089,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 2400
    },
    {
      "epoch": 0.11150343802267236,
      "eval_loss": 0.23828878750403723,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3197333514690399,
      "eval_objectnav_nopose_mae_dtheta": 0.041281331330537796,
      "eval_objectnav_nopose_mae_dx": 0.01378553081303835,
      "eval_objectnav_nopose_mae_dy": 0.005054965615272522,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3412506878376007,
      "eval_objectnav_nopose_pose_mae_dx": 0.11207162588834763,
      "eval_objectnav_nopose_pose_mae_dy": 0.05720743164420128,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5670058131217957,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24149736762046814,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13587377965450287,
      "eval_objectnav_nopose_pose_rmse_mean": 0.31479233503341675,
      "eval_objectnav_nopose_rmse_dtheta": 0.059322699904441833,
      "eval_objectnav_nopose_rmse_dx": 0.02661297470331192,
      "eval_objectnav_nopose_rmse_dy": 0.010414623655378819,
      "eval_objectnav_nopose_rmse_mean": 0.03211676701903343,
      "eval_objectnav_nopose_rotation_flip": 0.01466247159987688,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3197333514690399,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.29070159792900085,
      "eval_objectnav_pose_mae_dtheta": 0.03719358146190643,
      "eval_objectnav_pose_mae_dx": 0.011889178305864334,
      "eval_objectnav_pose_mae_dy": 0.004713761154562235,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2876196503639221,
      "eval_objectnav_pose_pose_mae_dx": 0.09527342021465302,
      "eval_objectnav_pose_pose_mae_dy": 0.05164230614900589,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5007767677307129,
      "eval_objectnav_pose_pose_rmse_dx": 0.21813152730464935,
      "eval_objectnav_pose_pose_rmse_dy": 0.12540332973003387,
      "eval_objectnav_pose_pose_rmse_mean": 0.2814372181892395,
      "eval_objectnav_pose_rmse_dtheta": 0.05521737039089203,
      "eval_objectnav_pose_rmse_dx": 0.02437758445739746,
      "eval_objectnav_pose_rmse_dy": 0.009908725507557392,
      "eval_objectnav_pose_rmse_mean": 0.029834561049938202,
      "eval_objectnav_pose_rotation_flip": 0.015102877281606197,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.29070159792900085,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10443141311407089,
      "eval_pointnav_mae_dtheta": 0.011763214133679867,
      "eval_pointnav_mae_dx": 0.0029386242385953665,
      "eval_pointnav_mae_dy": 0.002779754577204585,
      "eval_pointnav_pose_mae_dtheta": 0.08412906527519226,
      "eval_pointnav_pose_mae_dx": 0.03246541693806648,
      "eval_pointnav_pose_mae_dy": 0.03122520074248314,
      "eval_pointnav_pose_rmse_dtheta": 0.22897154092788696,
      "eval_pointnav_pose_rmse_dx": 0.09348829835653305,
      "eval_pointnav_pose_rmse_dy": 0.08586803823709488,
      "eval_pointnav_pose_rmse_mean": 0.13610929250717163,
      "eval_pointnav_rmse_dtheta": 0.027595294639468193,
      "eval_pointnav_rmse_dx": 0.008792063221335411,
      "eval_pointnav_rmse_dy": 0.007103801239281893,
      "eval_pointnav_rmse_mean": 0.014497052878141403,
      "eval_pointnav_rotation_flip": 0.004874651785939932,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10443141311407089,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 2400
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.11154989778851515,
      "grad_norm": 0.4743078052997589,
      "learning_rate": 9.118382907149164e-06,
      "loss": 0.0826,
      "mae_dtheta": 0.011496840044856071,
      "mae_dx": 0.0017310749972239137,
      "mae_dy": 0.002656811149790883,
      "pose_mae_dtheta": 0.07467351108789444,
      "pose_mae_dx": 0.026653485372662544,
      "pose_mae_dy": 0.03231523558497429,
      "pose_rmse_dtheta": 0.14719295501708984,
      "pose_rmse_dx": 0.06600108742713928,
      "pose_rmse_dy": 0.06862977892160416,
      "pose_rmse_mean": 0.09394127130508423,
      "rmse_dtheta": 0.02142433635890484,
      "rmse_dx": 0.00593305891379714,
      "rmse_dy": 0.005167259369045496,
      "rmse_mean": 0.010841552168130875,
      "rotation_flip": 0.0036049026530236006,
      "sparse_tokens": 32057.0,
      "step": 2401,
      "turn_loss": 0.09243851155042648,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.11159635755435793,
      "grad_norm": 0.61239093542099,
      "learning_rate": 9.117632985757516e-06,
      "loss": 0.1901,
      "mae_dtheta": 0.03095482848584652,
      "mae_dx": 0.0037413290701806545,
      "mae_dy": 0.004401068668812513,
      "pose_mae_dtheta": 0.2706843912601471,
      "pose_mae_dx": 0.022815367206931114,
      "pose_mae_dy": 0.09293422102928162,
      "pose_rmse_dtheta": 0.5329237580299377,
      "pose_rmse_dx": 0.044597078114748,
      "pose_rmse_dy": 0.18571560084819794,
      "pose_rmse_mean": 0.2544121742248535,
      "rmse_dtheta": 0.054833173751831055,
      "rmse_dx": 0.012882092036306858,
      "rmse_dy": 0.007632168475538492,
      "rmse_mean": 0.025115810334682465,
      "rotation_flip": 0.011904762126505375,
      "sparse_tokens": 5310.0,
      "step": 2402,
      "turn_loss": 0.1979736089706421,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.1116428173202007,
      "grad_norm": 0.9080040454864502,
      "learning_rate": 9.116882776417582e-06,
      "loss": 0.3004,
      "mae_dtheta": 0.030173230916261673,
      "mae_dx": 0.014156446792185307,
      "mae_dy": 0.004617625847458839,
      "pose_mae_dtheta": 0.2675440013408661,
      "pose_mae_dx": 0.11868806928396225,
      "pose_mae_dy": 0.061382196843624115,
      "pose_rmse_dtheta": 0.41708871722221375,
      "pose_rmse_dx": 0.2502712309360504,
      "pose_rmse_dy": 0.11730386316776276,
      "pose_rmse_mean": 0.2615545988082886,
      "rmse_dtheta": 0.04601934552192688,
      "rmse_dx": 0.027609461918473244,
      "rmse_dy": 0.008003945462405682,
      "rmse_mean": 0.027210917323827744,
      "rotation_flip": 0.005319148767739534,
      "sparse_tokens": 3602.0,
      "step": 2403,
      "turn_loss": 0.2122579663991928,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11168927708604348,
      "grad_norm": 0.617394208908081,
      "learning_rate": 9.116132279181826e-06,
      "loss": 0.1332,
      "mae_dtheta": 0.01176591869443655,
      "mae_dx": 0.002180872019380331,
      "mae_dy": 0.0028321053832769394,
      "pose_mae_dtheta": 0.08296815305948257,
      "pose_mae_dx": 0.03208305314183235,
      "pose_mae_dy": 0.03995214030146599,
      "pose_rmse_dtheta": 0.15583521127700806,
      "pose_rmse_dx": 0.07327532768249512,
      "pose_rmse_dy": 0.09495806694030762,
      "pose_rmse_mean": 0.10802286863327026,
      "rmse_dtheta": 0.02087407559156418,
      "rmse_dx": 0.006332301069051027,
      "rmse_dy": 0.0055472287349402905,
      "rmse_mean": 0.010917868465185165,
      "rotation_flip": 0.002774887252599001,
      "sparse_tokens": 32137.0,
      "step": 2404,
      "turn_loss": 0.09741128236055374,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.11173573685188627,
      "grad_norm": 0.46275246143341064,
      "learning_rate": 9.115381494102732e-06,
      "loss": 0.1334,
      "mae_dtheta": 0.03125467151403427,
      "mae_dx": 0.00963288452476263,
      "mae_dy": 0.004671815782785416,
      "pose_mae_dtheta": 0.24463361501693726,
      "pose_mae_dx": 0.0816245749592781,
      "pose_mae_dy": 0.04868436977267265,
      "pose_rmse_dtheta": 0.47289958596229553,
      "pose_rmse_dx": 0.20351172983646393,
      "pose_rmse_dy": 0.09463894367218018,
      "pose_rmse_mean": 0.25701677799224854,
      "rmse_dtheta": 0.0487997904419899,
      "rmse_dx": 0.020611219108104706,
      "rmse_dy": 0.008975262753665447,
      "rmse_mean": 0.026128757745027542,
      "rotation_flip": 0.016917293891310692,
      "sparse_tokens": 9584.0,
      "step": 2405,
      "turn_loss": 0.2606200873851776,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11178219661772905,
      "grad_norm": 0.36486580967903137,
      "learning_rate": 9.1146304212328e-06,
      "loss": 0.091,
      "mae_dtheta": 0.010108747519552708,
      "mae_dx": 0.001868058112449944,
      "mae_dy": 0.001488393172621727,
      "pose_mae_dtheta": 0.0680985301733017,
      "pose_mae_dx": 0.018897658213973045,
      "pose_mae_dy": 0.017769457772374153,
      "pose_rmse_dtheta": 0.17451469600200653,
      "pose_rmse_dx": 0.04730067774653435,
      "pose_rmse_dy": 0.04960745573043823,
      "pose_rmse_mean": 0.09047427773475647,
      "rmse_dtheta": 0.024366918951272964,
      "rmse_dx": 0.005637876223772764,
      "rmse_dy": 0.0033531344961375,
      "rmse_mean": 0.011119309812784195,
      "rotation_flip": 0.003621548181399703,
      "sparse_tokens": 32121.0,
      "step": 2406,
      "turn_loss": 0.06905049830675125,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.11182865638357183,
      "grad_norm": 0.5480465292930603,
      "learning_rate": 9.113879060624554e-06,
      "loss": 0.1019,
      "mae_dtheta": 0.009703295305371284,
      "mae_dx": 0.0013244400033727288,
      "mae_dy": 0.001699507120065391,
      "pose_mae_dtheta": 0.06414364278316498,
      "pose_mae_dx": 0.01884770393371582,
      "pose_mae_dy": 0.028232501819729805,
      "pose_rmse_dtheta": 0.14821037650108337,
      "pose_rmse_dx": 0.047763027250766754,
      "pose_rmse_dy": 0.0679444745182991,
      "pose_rmse_mean": 0.08797262609004974,
      "rmse_dtheta": 0.020150141790509224,
      "rmse_dx": 0.0045635271817445755,
      "rmse_dy": 0.0034271401818841696,
      "rmse_mean": 0.009380269795656204,
      "rotation_flip": 0.003683241317048669,
      "sparse_tokens": 32041.0,
      "step": 2407,
      "turn_loss": 0.0733286663889885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.1118751161494146,
      "grad_norm": 0.4629617929458618,
      "learning_rate": 9.113127412330536e-06,
      "loss": 0.1103,
      "mae_dtheta": 0.030615326017141342,
      "mae_dx": 0.011476379819214344,
      "mae_dy": 0.005080904345959425,
      "pose_mae_dtheta": 0.22924749553203583,
      "pose_mae_dx": 0.09193441271781921,
      "pose_mae_dy": 0.05340497940778732,
      "pose_rmse_dtheta": 0.38501861691474915,
      "pose_rmse_dx": 0.21208223700523376,
      "pose_rmse_dy": 0.1369180530309677,
      "pose_rmse_mean": 0.2446729838848114,
      "rmse_dtheta": 0.04555081948637962,
      "rmse_dx": 0.0229837317019701,
      "rmse_dy": 0.010691525414586067,
      "rmse_mean": 0.026408692821860313,
      "rotation_flip": 0.017329255118966103,
      "sparse_tokens": 16077.0,
      "step": 2408,
      "turn_loss": 0.2698449194431305,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.11192157591525739,
      "grad_norm": 0.7022169232368469,
      "learning_rate": 9.112375476403313e-06,
      "loss": 0.122,
      "mae_dtheta": 0.012952596880495548,
      "mae_dx": 0.0024609393440186977,
      "mae_dy": 0.003117974614724517,
      "pose_mae_dtheta": 0.09797178953886032,
      "pose_mae_dx": 0.025859417393803596,
      "pose_mae_dy": 0.030560771003365517,
      "pose_rmse_dtheta": 0.2603417932987213,
      "pose_rmse_dx": 0.07019133865833282,
      "pose_rmse_dy": 0.09240175783634186,
      "pose_rmse_mean": 0.14097830653190613,
      "rmse_dtheta": 0.02947118505835533,
      "rmse_dx": 0.0073961736634373665,
      "rmse_dy": 0.008043878711760044,
      "rmse_mean": 0.014970412477850914,
      "rotation_flip": 0.005979073233902454,
      "sparse_tokens": 32073.0,
      "step": 2409,
      "turn_loss": 0.10194995999336243,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.11196803568110017,
      "grad_norm": 0.6004714369773865,
      "learning_rate": 9.111623252895463e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.033356886357069016,
      "mae_dx": 0.01046543475240469,
      "mae_dy": 0.006216311827301979,
      "pose_mae_dtheta": 0.24595996737480164,
      "pose_mae_dx": 0.10222142189741135,
      "pose_mae_dy": 0.062055326998233795,
      "pose_rmse_dtheta": 0.40398257970809937,
      "pose_rmse_dx": 0.21360090374946594,
      "pose_rmse_dy": 0.12400298565626144,
      "pose_rmse_mean": 0.2471955120563507,
      "rmse_dtheta": 0.04956386238336563,
      "rmse_dx": 0.021754279732704163,
      "rmse_dy": 0.011095714755356312,
      "rmse_mean": 0.027471287176012993,
      "rotation_flip": 0.006544502452015877,
      "sparse_tokens": 10770.0,
      "step": 2410,
      "turn_loss": 0.27184435725212097,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.11201449544694295,
      "grad_norm": 0.45746198296546936,
      "learning_rate": 9.110870741859594e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.00762017210945487,
      "mae_dx": 0.0016645085997879505,
      "mae_dy": 0.00039166846545413136,
      "pose_mae_dtheta": 0.05566979944705963,
      "pose_mae_dx": 0.013268537819385529,
      "pose_mae_dy": 0.0056999013759195805,
      "pose_rmse_dtheta": 0.23266761004924774,
      "pose_rmse_dx": 0.0322662815451622,
      "pose_rmse_dy": 0.011811264790594578,
      "pose_rmse_mean": 0.09224838018417358,
      "rmse_dtheta": 0.02794766239821911,
      "rmse_dx": 0.004388670437037945,
      "rmse_dy": 0.0012631280114874244,
      "rmse_mean": 0.01119981985539198,
      "rotation_flip": 0.0018975331913679838,
      "sparse_tokens": 32201.0,
      "step": 2411,
      "turn_loss": 0.04644663631916046,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11206095521278572,
      "grad_norm": 0.5777408480644226,
      "learning_rate": 9.110117943348326e-06,
      "loss": 0.1529,
      "mae_dtheta": 0.012642227113246918,
      "mae_dx": 0.0028574878815561533,
      "mae_dy": 0.0030293543823063374,
      "pose_mae_dtheta": 0.08773840963840485,
      "pose_mae_dx": 0.029645467177033424,
      "pose_mae_dy": 0.034294936805963516,
      "pose_rmse_dtheta": 0.21338635683059692,
      "pose_rmse_dx": 0.06828664988279343,
      "pose_rmse_dy": 0.07961073517799377,
      "pose_rmse_mean": 0.1204279214143753,
      "rmse_dtheta": 0.027566513046622276,
      "rmse_dx": 0.007605287712067366,
      "rmse_dy": 0.007259045261889696,
      "rmse_mean": 0.014143615029752254,
      "rotation_flip": 0.002921840874478221,
      "sparse_tokens": 32121.0,
      "step": 2412,
      "turn_loss": 0.13784445822238922,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.11210741497862851,
      "grad_norm": 0.45784804224967957,
      "learning_rate": 9.109364857414306e-06,
      "loss": 0.0865,
      "mae_dtheta": 0.010088116861879826,
      "mae_dx": 0.002453622641041875,
      "mae_dy": 0.002659702440723777,
      "pose_mae_dtheta": 0.07046537846326828,
      "pose_mae_dx": 0.026986680924892426,
      "pose_mae_dy": 0.028984135016798973,
      "pose_rmse_dtheta": 0.16544491052627563,
      "pose_rmse_dx": 0.07597687840461731,
      "pose_rmse_dy": 0.06671706587076187,
      "pose_rmse_mean": 0.1027129516005516,
      "rmse_dtheta": 0.020693209022283554,
      "rmse_dx": 0.007797771133482456,
      "rmse_dy": 0.006214349530637264,
      "rmse_mean": 0.011568443849682808,
      "rotation_flip": 0.004415011033415794,
      "sparse_tokens": 32073.0,
      "step": 2413,
      "turn_loss": 0.09062820672988892,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11215387474447129,
      "grad_norm": 0.5136649012565613,
      "learning_rate": 9.108611484110195e-06,
      "loss": 0.1349,
      "mae_dtheta": 0.012364760041236877,
      "mae_dx": 0.002024784218519926,
      "mae_dy": 0.002672739326953888,
      "pose_mae_dtheta": 0.08313216269016266,
      "pose_mae_dx": 0.0255122072994709,
      "pose_mae_dy": 0.033179618418216705,
      "pose_rmse_dtheta": 0.2084171026945114,
      "pose_rmse_dx": 0.05858634412288666,
      "pose_rmse_dy": 0.07743743062019348,
      "pose_rmse_mean": 0.11481362581253052,
      "rmse_dtheta": 0.02618534117937088,
      "rmse_dx": 0.0055254059843719006,
      "rmse_dy": 0.005390082020312548,
      "rmse_mean": 0.012366943061351776,
      "rotation_flip": 0.0051834131591022015,
      "sparse_tokens": 32121.0,
      "step": 2414,
      "turn_loss": 0.10479734092950821,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11220033451031407,
      "grad_norm": 0.548259973526001,
      "learning_rate": 9.107857823488678e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.00911033432930708,
      "mae_dx": 0.0024666753597557545,
      "mae_dy": 0.0016826353967189789,
      "pose_mae_dtheta": 0.06312419474124908,
      "pose_mae_dx": 0.02440878003835678,
      "pose_mae_dy": 0.0246494822204113,
      "pose_rmse_dtheta": 0.15691615641117096,
      "pose_rmse_dx": 0.07127632200717926,
      "pose_rmse_dy": 0.059714674949645996,
      "pose_rmse_mean": 0.0959690511226654,
      "rmse_dtheta": 0.020722808316349983,
      "rmse_dx": 0.008086660876870155,
      "rmse_dy": 0.0038251031655818224,
      "rmse_mean": 0.010878190398216248,
      "rotation_flip": 0.005139919929206371,
      "sparse_tokens": 32089.0,
      "step": 2415,
      "turn_loss": 0.07784788310527802,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11224679427615684,
      "grad_norm": 0.440836638212204,
      "learning_rate": 9.107103875602458e-06,
      "loss": 0.1252,
      "mae_dtheta": 0.008819983340799809,
      "mae_dx": 0.0014348635450005531,
      "mae_dy": 0.0015733164036646485,
      "pose_mae_dtheta": 0.061481695622205734,
      "pose_mae_dx": 0.020318154245615005,
      "pose_mae_dy": 0.024552997201681137,
      "pose_rmse_dtheta": 0.17589299380779266,
      "pose_rmse_dx": 0.05112404003739357,
      "pose_rmse_dy": 0.06410235166549683,
      "pose_rmse_mean": 0.09703980386257172,
      "rmse_dtheta": 0.02261834777891636,
      "rmse_dx": 0.004516126122325659,
      "rmse_dy": 0.0037314279470592737,
      "rmse_mean": 0.010288634337484837,
      "rotation_flip": 0.006454816088080406,
      "sparse_tokens": 32089.0,
      "step": 2416,
      "turn_loss": 0.0666339248418808,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.11229325404199964,
      "grad_norm": 0.5963940024375916,
      "learning_rate": 9.10634964050426e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.03571924939751625,
      "mae_dx": 0.011899235658347607,
      "mae_dy": 0.0044678738340735435,
      "pose_mae_dtheta": 0.2767425775527954,
      "pose_mae_dx": 0.0911201611161232,
      "pose_mae_dy": 0.051931437104940414,
      "pose_rmse_dtheta": 0.48205986618995667,
      "pose_rmse_dx": 0.20163623988628387,
      "pose_rmse_dy": 0.09731164574623108,
      "pose_rmse_mean": 0.26033592224121094,
      "rmse_dtheta": 0.05293302983045578,
      "rmse_dx": 0.024067969992756844,
      "rmse_dy": 0.00771702453494072,
      "rmse_mean": 0.028239339590072632,
      "rotation_flip": 0.01702786423265934,
      "sparse_tokens": 11150.0,
      "step": 2417,
      "turn_loss": 0.27628815174102783,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11233971380784241,
      "grad_norm": 0.6500690579414368,
      "learning_rate": 9.105595118246829e-06,
      "loss": 0.1489,
      "mae_dtheta": 0.01122652180492878,
      "mae_dx": 0.0019662193953990936,
      "mae_dy": 0.0028787648770958185,
      "pose_mae_dtheta": 0.0795997828245163,
      "pose_mae_dx": 0.027562588453292847,
      "pose_mae_dy": 0.032847240567207336,
      "pose_rmse_dtheta": 0.1990421712398529,
      "pose_rmse_dx": 0.08284065127372742,
      "pose_rmse_dy": 0.09312687814235687,
      "pose_rmse_mean": 0.12500324845314026,
      "rmse_dtheta": 0.02390950173139572,
      "rmse_dx": 0.005611426662653685,
      "rmse_dy": 0.007292316295206547,
      "rmse_mean": 0.012271082028746605,
      "rotation_flip": 0.0017429194413125515,
      "sparse_tokens": 32105.0,
      "step": 2418,
      "turn_loss": 0.10577788203954697,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.11238617357368519,
      "grad_norm": 0.44344210624694824,
      "learning_rate": 9.104840308882925e-06,
      "loss": 0.0975,
      "mae_dtheta": 0.03417276218533516,
      "mae_dx": 0.013582969084382057,
      "mae_dy": 0.003419708227738738,
      "pose_mae_dtheta": 0.25328144431114197,
      "pose_mae_dx": 0.10869928449392319,
      "pose_mae_dy": 0.055811796337366104,
      "pose_rmse_dtheta": 0.45332470536231995,
      "pose_rmse_dx": 0.24122367799282074,
      "pose_rmse_dy": 0.11735178530216217,
      "pose_rmse_mean": 0.27063339948654175,
      "rmse_dtheta": 0.05080482363700867,
      "rmse_dx": 0.027327213436365128,
      "rmse_dy": 0.006676173768937588,
      "rmse_mean": 0.02826940268278122,
      "rotation_flip": 0.016227180138230324,
      "sparse_tokens": 9976.0,
      "step": 2419,
      "turn_loss": 0.25285103917121887,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.11243263333952797,
      "grad_norm": 0.5176428556442261,
      "learning_rate": 9.104085212465337e-06,
      "loss": 0.1132,
      "mae_dtheta": 0.012078775092959404,
      "mae_dx": 0.005310571752488613,
      "mae_dy": 0.007040591910481453,
      "pose_mae_dtheta": 0.09855154901742935,
      "pose_mae_dx": 0.015263662673532963,
      "pose_mae_dy": 0.08795846998691559,
      "pose_rmse_dtheta": 0.15005096793174744,
      "pose_rmse_dx": 0.02819463424384594,
      "pose_rmse_dy": 0.1857934445142746,
      "pose_rmse_mean": 0.1213463544845581,
      "rmse_dtheta": 0.019455233588814735,
      "rmse_dx": 0.014839121140539646,
      "rmse_dy": 0.01350291259586811,
      "rmse_mean": 0.015932423993945122,
      "rotation_flip": 0.0,
      "sparse_tokens": 2587.0,
      "step": 2420,
      "turn_loss": 0.18111242353916168,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11247909310537074,
      "grad_norm": 0.5256361961364746,
      "learning_rate": 9.103329829046866e-06,
      "loss": 0.1366,
      "mae_dtheta": 0.012251057662069798,
      "mae_dx": 0.001886543002910912,
      "mae_dy": 0.0020968113094568253,
      "pose_mae_dtheta": 0.08977060765028,
      "pose_mae_dx": 0.023405402898788452,
      "pose_mae_dy": 0.027813518419861794,
      "pose_rmse_dtheta": 0.2512163519859314,
      "pose_rmse_dx": 0.06430032104253769,
      "pose_rmse_dy": 0.07184810191392899,
      "pose_rmse_mean": 0.1291216015815735,
      "rmse_dtheta": 0.02858717367053032,
      "rmse_dx": 0.005601278506219387,
      "rmse_dy": 0.004797284957021475,
      "rmse_mean": 0.01299524586647749,
      "rotation_flip": 0.004564126022160053,
      "sparse_tokens": 32121.0,
      "step": 2421,
      "turn_loss": 0.08601587265729904,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.11252555287121353,
      "grad_norm": 0.4188852906227112,
      "learning_rate": 9.102574158680339e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.010841836221516132,
      "mae_dx": 0.002185689052566886,
      "mae_dy": 0.002556630177423358,
      "pose_mae_dtheta": 0.06694481521844864,
      "pose_mae_dx": 0.026925474405288696,
      "pose_mae_dy": 0.027066141366958618,
      "pose_rmse_dtheta": 0.12806421518325806,
      "pose_rmse_dx": 0.06364636868238449,
      "pose_rmse_dy": 0.0618419274687767,
      "pose_rmse_mean": 0.08451750874519348,
      "rmse_dtheta": 0.019811036065220833,
      "rmse_dx": 0.0056403400376439095,
      "rmse_dy": 0.00488117104396224,
      "rmse_mean": 0.010110849514603615,
      "rotation_flip": 0.0062283738516271114,
      "sparse_tokens": 32169.0,
      "step": 2422,
      "turn_loss": 0.10381856560707092,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11257201263705631,
      "grad_norm": 0.4915141463279724,
      "learning_rate": 9.101818201418598e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.008593153208494186,
      "mae_dx": 0.0015902474988251925,
      "mae_dy": 0.0020038338843733072,
      "pose_mae_dtheta": 0.05689641088247299,
      "pose_mae_dx": 0.020842306315898895,
      "pose_mae_dy": 0.021552015095949173,
      "pose_rmse_dtheta": 0.15446527302265167,
      "pose_rmse_dx": 0.05321607366204262,
      "pose_rmse_dy": 0.05482681840658188,
      "pose_rmse_mean": 0.08750271797180176,
      "rmse_dtheta": 0.020699048414826393,
      "rmse_dx": 0.0043961103074252605,
      "rmse_dy": 0.004737112671136856,
      "rmse_mean": 0.009944090619683266,
      "rotation_flip": 0.003639672417193651,
      "sparse_tokens": 32089.0,
      "step": 2423,
      "turn_loss": 0.06639793515205383,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.11261847240289909,
      "grad_norm": 0.6388607025146484,
      "learning_rate": 9.10106195731451e-06,
      "loss": 0.1265,
      "mae_dtheta": 0.016383357346057892,
      "mae_dx": 0.0035191611386835575,
      "mae_dy": 0.0028322397265583277,
      "pose_mae_dtheta": 0.1113259419798851,
      "pose_mae_dx": 0.03644605726003647,
      "pose_mae_dy": 0.03778817877173424,
      "pose_rmse_dtheta": 0.2393738180398941,
      "pose_rmse_dx": 0.08721540123224258,
      "pose_rmse_dy": 0.09256391227245331,
      "pose_rmse_mean": 0.1397177278995514,
      "rmse_dtheta": 0.03177618607878685,
      "rmse_dx": 0.009609440341591835,
      "rmse_dy": 0.006057503633201122,
      "rmse_mean": 0.01581437885761261,
      "rotation_flip": 0.007503410801291466,
      "sparse_tokens": 32217.0,
      "step": 2424,
      "turn_loss": 0.14746803045272827,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.11266493216874186,
      "grad_norm": 0.6761505603790283,
      "learning_rate": 9.100305426420957e-06,
      "loss": 0.1776,
      "mae_dtheta": 0.046889740973711014,
      "mae_dx": 0.010126429609954357,
      "mae_dy": 0.002278928179293871,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6761504411697388,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 133.05809020996094,
      "model/head/act_norm_mean": 99.82015830592105,
      "model/head/act_norm_min": 67.04344177246094,
      "model/head/act_over_embed": 68.59734731887478,
      "model/head/grad_frac": 0.11430635303258896,
      "model/head/grad_norm": 0.07728829234838486,
      "model/head/grad_zero_frac": 0.00019036306184716523,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6711040296052632,
      "model/head/update_ratio": 0.001337632187642157,
      "model/head/weight_delta": 5.683710098266602,
      "model/head/weight_delta_rel": 0.09970910847187042,
      "model/head/weight_norm": 57.779930114746094,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4152514338493347,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4151931285858154,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41513922810554504,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28532460506348445,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0649409070611,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04390982538461685,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5421875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014264159835875034,
      "model/modality_embedder.encoders.pose/weight_delta": 1.8439669609069824,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06024814769625664,
      "model/modality_embedder.encoders.pose/weight_norm": 30.7833251953125,
      "model/modality_embedder/grad_frac": 0.0649409070611,
      "model/modality_embedder/grad_norm": 0.04390982538461685,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5421875,
      "model/modality_embedder/update_ratio": 0.0014264159835875034,
      "model/modality_embedder/weight_delta": 1.8439669609069824,
      "model/modality_embedder/weight_delta_rel": 0.06024814769625664,
      "model/modality_embedder/weight_norm": 30.7833251953125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 67.80608367919922,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.489792188805346,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.262609481811523,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.455195744898818,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07079722732305527,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04786957800388336,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017321055056527257,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.179648995399475,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.042987119406461716,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.636640548706055,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 69.21997833251953,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.450674211570593,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.89009952545166,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.115522866862324,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07881414145231247,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.053290218114852905,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018237056210637093,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.4776335954666138,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05118638277053833,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.220844268798828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 70.92733001708984,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.243045765455307,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.439788818359375,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.347257379138767,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08255249261856079,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05581790208816528,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001850708620622754,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.5792127847671509,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05302700772881508,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.16028594970703,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 71.91412353515625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.175523444026734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.753756523132324,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.675274131994126,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08429010212421417,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0569927878677845,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019299020059406757,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.3473632335662842,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.046046480536460876,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.53144073486328,
      "model/normalizer/grad_frac": 0.2988252341747284,
      "model/normalizer/grad_norm": 0.2020508199930191,
      "model/normalizer/grad_zero_frac": 0.0002115311799570918,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002589072333648801,
      "model/normalizer/weight_delta": 2.8754093647003174,
      "model/normalizer/weight_delta_rel": 0.03703360632061958,
      "model/normalizer/weight_norm": 78.03984832763672,
      "pose_mae_dtheta": 0.45252370834350586,
      "pose_mae_dx": 0.07191302627325058,
      "pose_mae_dy": 0.019366754218935966,
      "pose_rmse_dtheta": 0.7411030530929565,
      "pose_rmse_dx": 0.17590098083019257,
      "pose_rmse_dy": 0.056042883545160294,
      "pose_rmse_mean": 0.32434898614883423,
      "rmse_dtheta": 0.06913401186466217,
      "rmse_dx": 0.021378563717007637,
      "rmse_dy": 0.005027160979807377,
      "rmse_mean": 0.031846579164266586,
      "rotation_flip": 0.013201320543885231,
      "sparse_tokens": 4758.0,
      "step": 2425,
      "turn_loss": 0.2612130641937256,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11271139193458465,
      "grad_norm": 0.5325438380241394,
      "learning_rate": 9.099548608790844e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.014317277818918228,
      "mae_dx": 0.002734383102506399,
      "mae_dy": 0.0036924888845533133,
      "pose_mae_dtheta": 0.09862510859966278,
      "pose_mae_dx": 0.0324658565223217,
      "pose_mae_dy": 0.039091695100069046,
      "pose_rmse_dtheta": 0.22758181393146515,
      "pose_rmse_dx": 0.09104011207818985,
      "pose_rmse_dy": 0.09447571635246277,
      "pose_rmse_mean": 0.1376992166042328,
      "rmse_dtheta": 0.02883821167051792,
      "rmse_dx": 0.007555398158729076,
      "rmse_dy": 0.008313716389238834,
      "rmse_mean": 0.014902441762387753,
      "rotation_flip": 0.008711433969438076,
      "sparse_tokens": 32137.0,
      "step": 2426,
      "turn_loss": 0.12671983242034912,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.11275785170042743,
      "grad_norm": 0.6424148082733154,
      "learning_rate": 9.098791504477098e-06,
      "loss": 0.1137,
      "mae_dtheta": 0.013430074788630009,
      "mae_dx": 0.0030787924770265818,
      "mae_dy": 0.003514006733894348,
      "pose_mae_dtheta": 0.09627346694469452,
      "pose_mae_dx": 0.03395573049783707,
      "pose_mae_dy": 0.042075127363204956,
      "pose_rmse_dtheta": 0.2304311990737915,
      "pose_rmse_dx": 0.11092129349708557,
      "pose_rmse_dy": 0.09069560468196869,
      "pose_rmse_mean": 0.14401602745056152,
      "rmse_dtheta": 0.02760908380150795,
      "rmse_dx": 0.010432607494294643,
      "rmse_dy": 0.008102853782474995,
      "rmse_mean": 0.01538151502609253,
      "rotation_flip": 0.0029142380226403475,
      "sparse_tokens": 32073.0,
      "step": 2427,
      "turn_loss": 0.11159149557352066,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11280431146627021,
      "grad_norm": 0.5725966691970825,
      "learning_rate": 9.09803411353266e-06,
      "loss": 0.1,
      "mae_dtheta": 0.013414476998150349,
      "mae_dx": 0.0023271942045539618,
      "mae_dy": 0.0032694751862436533,
      "pose_mae_dtheta": 0.09632328897714615,
      "pose_mae_dx": 0.034059617668390274,
      "pose_mae_dy": 0.038821037858724594,
      "pose_rmse_dtheta": 0.2150421291589737,
      "pose_rmse_dx": 0.08309440314769745,
      "pose_rmse_dy": 0.08630657941102982,
      "pose_rmse_mean": 0.12814770638942719,
      "rmse_dtheta": 0.026084018871188164,
      "rmse_dx": 0.006384559441357851,
      "rmse_dy": 0.006826124619692564,
      "rmse_mean": 0.013098235242068768,
      "rotation_flip": 0.0035486160777509212,
      "sparse_tokens": 32089.0,
      "step": 2428,
      "turn_loss": 0.1081538274884224,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.11285077123211298,
      "grad_norm": 1.0025664567947388,
      "learning_rate": 9.097276436010499e-06,
      "loss": 0.277,
      "mae_dtheta": 0.03473572060465813,
      "mae_dx": 0.008022049441933632,
      "mae_dy": 0.009264025837182999,
      "pose_mae_dtheta": 0.28536728024482727,
      "pose_mae_dx": 0.09121503680944443,
      "pose_mae_dy": 0.1309429556131363,
      "pose_rmse_dtheta": 0.465197890996933,
      "pose_rmse_dx": 0.20977699756622314,
      "pose_rmse_dy": 0.25855931639671326,
      "pose_rmse_mean": 0.3111780881881714,
      "rmse_dtheta": 0.051892269402742386,
      "rmse_dx": 0.01961204595863819,
      "rmse_dy": 0.015632344409823418,
      "rmse_mean": 0.029045555740594864,
      "rotation_flip": 0.01115760114043951,
      "sparse_tokens": 12003.0,
      "step": 2429,
      "turn_loss": 0.26122522354125977,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11289723099795577,
      "grad_norm": 0.5702989101409912,
      "learning_rate": 9.096518471963598e-06,
      "loss": 0.1238,
      "mae_dtheta": 0.012289516627788544,
      "mae_dx": 0.0025125148240476847,
      "mae_dy": 0.0036526070907711983,
      "pose_mae_dtheta": 0.08364435285329819,
      "pose_mae_dx": 0.03484617918729782,
      "pose_mae_dy": 0.039944957941770554,
      "pose_rmse_dtheta": 0.17307162284851074,
      "pose_rmse_dx": 0.0932847186923027,
      "pose_rmse_dy": 0.08582577109336853,
      "pose_rmse_mean": 0.11739404499530792,
      "rmse_dtheta": 0.023809244856238365,
      "rmse_dx": 0.006421851925551891,
      "rmse_dy": 0.007971388287842274,
      "rmse_mean": 0.01273416168987751,
      "rotation_flip": 0.003976142965257168,
      "sparse_tokens": 32105.0,
      "step": 2430,
      "turn_loss": 0.10393314808607101,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.11294369076379855,
      "grad_norm": 0.4963458478450775,
      "learning_rate": 9.09576022144496e-06,
      "loss": 0.1382,
      "mae_dtheta": 0.027303172275424004,
      "mae_dx": 0.008695477619767189,
      "mae_dy": 0.0029823624063283205,
      "pose_mae_dtheta": 0.19799107313156128,
      "pose_mae_dx": 0.06690172106027603,
      "pose_mae_dy": 0.03596718609333038,
      "pose_rmse_dtheta": 0.36906763911247253,
      "pose_rmse_dx": 0.1416679173707962,
      "pose_rmse_dy": 0.10598097741603851,
      "pose_rmse_mean": 0.2055721879005432,
      "rmse_dtheta": 0.04636001959443092,
      "rmse_dx": 0.018613755702972412,
      "rmse_dy": 0.006846231874078512,
      "rmse_mean": 0.02394000254571438,
      "rotation_flip": 0.01104972418397665,
      "sparse_tokens": 7363.0,
      "step": 2431,
      "turn_loss": 0.19496765732765198,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.11299015052964133,
      "grad_norm": 0.49286511540412903,
      "learning_rate": 9.095001684507612e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.02871526964008808,
      "mae_dx": 0.010103607550263405,
      "mae_dy": 0.0031933076679706573,
      "pose_mae_dtheta": 0.2408466637134552,
      "pose_mae_dx": 0.07699760049581528,
      "pose_mae_dy": 0.04043181985616684,
      "pose_rmse_dtheta": 0.42406702041625977,
      "pose_rmse_dx": 0.20405642688274384,
      "pose_rmse_dy": 0.09030669182538986,
      "pose_rmse_mean": 0.23947672545909882,
      "rmse_dtheta": 0.04732668027281761,
      "rmse_dx": 0.023227620869874954,
      "rmse_dy": 0.0077151944860816,
      "rmse_mean": 0.026089832186698914,
      "rotation_flip": 0.017467249184846878,
      "sparse_tokens": 17974.0,
      "step": 2432,
      "turn_loss": 0.20246806740760803,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1130366102954841,
      "grad_norm": 0.4092939794063568,
      "learning_rate": 9.094242861204598e-06,
      "loss": 0.0824,
      "mae_dtheta": 0.010666094720363617,
      "mae_dx": 0.00218677194789052,
      "mae_dy": 0.001964692957699299,
      "pose_mae_dtheta": 0.07545454055070877,
      "pose_mae_dx": 0.025797279551625252,
      "pose_mae_dy": 0.0259332824498415,
      "pose_rmse_dtheta": 0.2086700201034546,
      "pose_rmse_dx": 0.06902619451284409,
      "pose_rmse_dy": 0.06240265443921089,
      "pose_rmse_mean": 0.11336629837751389,
      "rmse_dtheta": 0.025571143254637718,
      "rmse_dx": 0.006464358884841204,
      "rmse_dy": 0.004778833128511906,
      "rmse_mean": 0.012271445244550705,
      "rotation_flip": 0.003954522777348757,
      "sparse_tokens": 32121.0,
      "step": 2433,
      "turn_loss": 0.077972911298275,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1130830700613269,
      "grad_norm": 0.5089021325111389,
      "learning_rate": 9.093483751588982e-06,
      "loss": 0.1815,
      "mae_dtheta": 0.012719814665615559,
      "mae_dx": 0.002699353266507387,
      "mae_dy": 0.0034446753561496735,
      "pose_mae_dtheta": 0.09462208300828934,
      "pose_mae_dx": 0.0329102948307991,
      "pose_mae_dy": 0.04546457156538963,
      "pose_rmse_dtheta": 0.2160249799489975,
      "pose_rmse_dx": 0.08095430582761765,
      "pose_rmse_dy": 0.10061667859554291,
      "pose_rmse_mean": 0.13253198564052582,
      "rmse_dtheta": 0.02484123408794403,
      "rmse_dx": 0.008246016688644886,
      "rmse_dy": 0.007785584777593613,
      "rmse_mean": 0.013624278828501701,
      "rotation_flip": 0.004140786826610565,
      "sparse_tokens": 32089.0,
      "step": 2434,
      "turn_loss": 0.11940202862024307,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 692.0,
      "epoch": 0.11312952982716967,
      "grad_norm": 0.49570947885513306,
      "learning_rate": 9.092724355713854e-06,
      "loss": 0.0816,
      "mae_dtheta": 0.03546804562211037,
      "mae_dx": 0.030021796002984047,
      "mae_dy": 0.008327960968017578,
      "pose_mae_dtheta": 0.1653340607881546,
      "pose_mae_dx": 0.22230248153209686,
      "pose_mae_dy": 0.0885116383433342,
      "pose_rmse_dtheta": 0.22028017044067383,
      "pose_rmse_dx": 0.352713406085968,
      "pose_rmse_dy": 0.1267130970954895,
      "pose_rmse_mean": 0.23323556780815125,
      "rmse_dtheta": 0.045131150633096695,
      "rmse_dx": 0.041028376668691635,
      "rmse_dy": 0.011117531917989254,
      "rmse_mean": 0.032425686717033386,
      "rotation_flip": 0.05882352963089943,
      "sparse_tokens": 614.0,
      "step": 2435,
      "turn_loss": 0.23825660347938538,
      "turns": 2.0,
      "turns_per_sample": 2.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.11317598959301245,
      "grad_norm": 0.5090015530586243,
      "learning_rate": 9.091964673632311e-06,
      "loss": 0.165,
      "mae_dtheta": 0.008235872723162174,
      "mae_dx": 0.001789983594790101,
      "mae_dy": 0.0015104335034266114,
      "pose_mae_dtheta": 0.055295079946517944,
      "pose_mae_dx": 0.01847105473279953,
      "pose_mae_dy": 0.01982116512954235,
      "pose_rmse_dtheta": 0.16174925863742828,
      "pose_rmse_dx": 0.060378242284059525,
      "pose_rmse_dy": 0.05679977685213089,
      "pose_rmse_mean": 0.09297575801610947,
      "rmse_dtheta": 0.02254817634820938,
      "rmse_dx": 0.006410621106624603,
      "rmse_dy": 0.004134363494813442,
      "rmse_mean": 0.011031053960323334,
      "rotation_flip": 0.0068389056250452995,
      "sparse_tokens": 32057.0,
      "step": 2436,
      "turn_loss": 0.057049162685871124,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.11322244935885523,
      "grad_norm": 0.5219152569770813,
      "learning_rate": 9.091204705397485e-06,
      "loss": 0.194,
      "mae_dtheta": 0.016229581087827682,
      "mae_dx": 0.0035969745367765427,
      "mae_dy": 0.003590820822864771,
      "pose_mae_dtheta": 0.12072670459747314,
      "pose_mae_dx": 0.04002079367637634,
      "pose_mae_dy": 0.04720005765557289,
      "pose_rmse_dtheta": 0.24862875044345856,
      "pose_rmse_dx": 0.08548992872238159,
      "pose_rmse_dy": 0.11447040736675262,
      "pose_rmse_mean": 0.14952969551086426,
      "rmse_dtheta": 0.02972266636788845,
      "rmse_dx": 0.008484890684485435,
      "rmse_dy": 0.007664529141038656,
      "rmse_mean": 0.015290695242583752,
      "rotation_flip": 0.00792752020061016,
      "sparse_tokens": 32153.0,
      "step": 2437,
      "turn_loss": 0.17873606085777283,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12959.0,
      "epoch": 0.11326890912469802,
      "grad_norm": 0.5808733701705933,
      "learning_rate": 9.090444451062516e-06,
      "loss": 0.1458,
      "mae_dtheta": 0.03506495803594589,
      "mae_dx": 0.010693558491766453,
      "mae_dy": 0.00561019079759717,
      "pose_mae_dtheta": 0.2632962465286255,
      "pose_mae_dx": 0.07849456369876862,
      "pose_mae_dy": 0.07398264110088348,
      "pose_rmse_dtheta": 0.5296960473060608,
      "pose_rmse_dx": 0.1592743992805481,
      "pose_rmse_dy": 0.1590515822172165,
      "pose_rmse_mean": 0.28267401456832886,
      "rmse_dtheta": 0.056466102600097656,
      "rmse_dx": 0.021781237795948982,
      "rmse_dy": 0.011203145608305931,
      "rmse_mean": 0.029816828668117523,
      "rotation_flip": 0.018518518656492233,
      "sparse_tokens": 9689.0,
      "step": 2438,
      "turn_loss": 0.24954922497272491,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 23043.0,
      "epoch": 0.1133153688905408,
      "grad_norm": 0.9358528256416321,
      "learning_rate": 9.08968391068057e-06,
      "loss": 0.2995,
      "mae_dtheta": 0.03859749808907509,
      "mae_dx": 0.009211116470396519,
      "mae_dy": 0.002992589958012104,
      "pose_mae_dtheta": 0.2953381836414337,
      "pose_mae_dx": 0.06145129352807999,
      "pose_mae_dy": 0.03483075648546219,
      "pose_rmse_dtheta": 0.5156350135803223,
      "pose_rmse_dx": 0.1588950902223587,
      "pose_rmse_dy": 0.10769762098789215,
      "pose_rmse_mean": 0.26074257493019104,
      "rmse_dtheta": 0.05957216024398804,
      "rmse_dx": 0.021144460886716843,
      "rmse_dy": 0.00755740562453866,
      "rmse_mean": 0.029424678534269333,
      "rotation_flip": 0.01443464308977127,
      "sparse_tokens": 17562.0,
      "step": 2439,
      "turn_loss": 0.28235727548599243,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.11336182865638357,
      "grad_norm": 0.5541478991508484,
      "learning_rate": 9.088923084304837e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.01695098541676998,
      "mae_dx": 0.004728139378130436,
      "mae_dy": 0.004736917093396187,
      "pose_mae_dtheta": 0.12930084764957428,
      "pose_mae_dx": 0.045947495847940445,
      "pose_mae_dy": 0.04485683888196945,
      "pose_rmse_dtheta": 0.2875804901123047,
      "pose_rmse_dx": 0.10421368479728699,
      "pose_rmse_dy": 0.10699503123760223,
      "pose_rmse_mean": 0.16626307368278503,
      "rmse_dtheta": 0.033529944717884064,
      "rmse_dx": 0.012195940129458904,
      "rmse_dy": 0.010950065217912197,
      "rmse_mean": 0.018891984596848488,
      "rotation_flip": 0.012024047784507275,
      "sparse_tokens": 32169.0,
      "step": 2440,
      "turn_loss": 0.18024802207946777,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18450.0,
      "epoch": 0.11340828842222635,
      "grad_norm": 0.6432878375053406,
      "learning_rate": 9.088161971988517e-06,
      "loss": 0.1869,
      "mae_dtheta": 0.02969200722873211,
      "mae_dx": 0.016237465664744377,
      "mae_dy": 0.007103302516043186,
      "pose_mae_dtheta": 0.2281666100025177,
      "pose_mae_dx": 0.1298043131828308,
      "pose_mae_dy": 0.09211242944002151,
      "pose_rmse_dtheta": 0.41921699047088623,
      "pose_rmse_dx": 0.264212042093277,
      "pose_rmse_dy": 0.18776562809944153,
      "pose_rmse_mean": 0.2903982102870941,
      "rmse_dtheta": 0.04640594497323036,
      "rmse_dx": 0.03005160577595234,
      "rmse_dy": 0.01290176622569561,
      "rmse_mean": 0.02978644147515297,
      "rotation_flip": 0.023612750694155693,
      "sparse_tokens": 15178.0,
      "step": 2441,
      "turn_loss": 0.2548999488353729,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.11345474818806914,
      "grad_norm": 0.5331631898880005,
      "learning_rate": 9.087400573784833e-06,
      "loss": 0.2153,
      "mae_dtheta": 0.03632872924208641,
      "mae_dx": 0.01544047798961401,
      "mae_dy": 0.008466491475701332,
      "pose_mae_dtheta": 0.2637943625450134,
      "pose_mae_dx": 0.13202472031116486,
      "pose_mae_dy": 0.09347578883171082,
      "pose_rmse_dtheta": 0.45629504323005676,
      "pose_rmse_dx": 0.27233046293258667,
      "pose_rmse_dy": 0.21472470462322235,
      "pose_rmse_mean": 0.31445008516311646,
      "rmse_dtheta": 0.05436960607767105,
      "rmse_dx": 0.028178036212921143,
      "rmse_dy": 0.017553012818098068,
      "rmse_mean": 0.03336688503623009,
      "rotation_flip": 0.013933547772467136,
      "sparse_tokens": 13953.0,
      "step": 2442,
      "turn_loss": 0.3617180585861206,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11350120795391191,
      "grad_norm": 0.4828729033470154,
      "learning_rate": 9.086638889747034e-06,
      "loss": 0.0798,
      "mae_dtheta": 0.010946535505354404,
      "mae_dx": 0.002390402602031827,
      "mae_dy": 0.0028268794994801283,
      "pose_mae_dtheta": 0.07585923373699188,
      "pose_mae_dx": 0.03064342774450779,
      "pose_mae_dy": 0.034410297870635986,
      "pose_rmse_dtheta": 0.1570960432291031,
      "pose_rmse_dx": 0.07662299275398254,
      "pose_rmse_dy": 0.08153659105300903,
      "pose_rmse_mean": 0.10508521646261215,
      "rmse_dtheta": 0.02162186987698078,
      "rmse_dx": 0.006663322448730469,
      "rmse_dy": 0.006411160342395306,
      "rmse_mean": 0.011565450578927994,
      "rotation_flip": 0.003475239034742117,
      "sparse_tokens": 32089.0,
      "step": 2443,
      "turn_loss": 0.0991789698600769,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.11354766771975469,
      "grad_norm": 0.5057511329650879,
      "learning_rate": 9.085876919928387e-06,
      "loss": 0.1509,
      "mae_dtheta": 0.04068106785416603,
      "mae_dx": 0.015010198578238487,
      "mae_dy": 0.004119970370084047,
      "pose_mae_dtheta": 0.34437239170074463,
      "pose_mae_dx": 0.1336856186389923,
      "pose_mae_dy": 0.05999153107404709,
      "pose_rmse_dtheta": 0.5967892408370972,
      "pose_rmse_dx": 0.281461626291275,
      "pose_rmse_dy": 0.14172808825969696,
      "pose_rmse_mean": 0.3399929702281952,
      "rmse_dtheta": 0.061233725398778915,
      "rmse_dx": 0.028135530650615692,
      "rmse_dy": 0.00925754476338625,
      "rmse_mean": 0.03287560120224953,
      "rotation_flip": 0.006698564626276493,
      "sparse_tokens": 18439.0,
      "step": 2444,
      "turn_loss": 0.25114285945892334,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11359412748559747,
      "grad_norm": 0.4345671236515045,
      "learning_rate": 9.085114664382171e-06,
      "loss": 0.1237,
      "mae_dtheta": 0.012990212999284267,
      "mae_dx": 0.0023454935289919376,
      "mae_dy": 0.003652743063867092,
      "pose_mae_dtheta": 0.08226204663515091,
      "pose_mae_dx": 0.027711879462003708,
      "pose_mae_dy": 0.03583535552024841,
      "pose_rmse_dtheta": 0.17794328927993774,
      "pose_rmse_dx": 0.06384250521659851,
      "pose_rmse_dy": 0.07949185371398926,
      "pose_rmse_mean": 0.10709255188703537,
      "rmse_dtheta": 0.025778040289878845,
      "rmse_dx": 0.006542753428220749,
      "rmse_dy": 0.008199314586818218,
      "rmse_mean": 0.013506703078746796,
      "rotation_flip": 0.0031835867557674646,
      "sparse_tokens": 32105.0,
      "step": 2445,
      "turn_loss": 0.11450709402561188,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.11364058725144026,
      "grad_norm": 0.5239276885986328,
      "learning_rate": 9.084352123161695e-06,
      "loss": 0.1433,
      "mae_dtheta": 0.030357714742422104,
      "mae_dx": 0.0090901218354702,
      "mae_dy": 0.0037677406799048185,
      "pose_mae_dtheta": 0.2515435516834259,
      "pose_mae_dx": 0.08025018870830536,
      "pose_mae_dy": 0.050078392028808594,
      "pose_rmse_dtheta": 0.4739202558994293,
      "pose_rmse_dx": 0.20485438406467438,
      "pose_rmse_dy": 0.11661221086978912,
      "pose_rmse_mean": 0.2651289701461792,
      "rmse_dtheta": 0.049683649092912674,
      "rmse_dx": 0.021089958027005196,
      "rmse_dy": 0.007587961386889219,
      "rmse_mean": 0.02612052485346794,
      "rotation_flip": 0.00929368007928133,
      "sparse_tokens": 20314.0,
      "step": 2446,
      "turn_loss": 0.18862631916999817,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.11368704701728304,
      "grad_norm": 0.6469842195510864,
      "learning_rate": 9.083589296320283e-06,
      "loss": 0.2118,
      "mae_dtheta": 0.03435736149549484,
      "mae_dx": 0.006989695131778717,
      "mae_dy": 0.004182473290711641,
      "pose_mae_dtheta": 0.2465931922197342,
      "pose_mae_dx": 0.041876938194036484,
      "pose_mae_dy": 0.03860282525420189,
      "pose_rmse_dtheta": 0.5297576189041138,
      "pose_rmse_dx": 0.0816364735364914,
      "pose_rmse_dy": 0.08513220399618149,
      "pose_rmse_mean": 0.23217543959617615,
      "rmse_dtheta": 0.05785870552062988,
      "rmse_dx": 0.014427636750042439,
      "rmse_dy": 0.007502752356231213,
      "rmse_mean": 0.026596365496516228,
      "rotation_flip": 0.007380073890089989,
      "sparse_tokens": 4597.0,
      "step": 2447,
      "turn_loss": 0.20817025005817413,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11373350678312581,
      "grad_norm": 0.5501766800880432,
      "learning_rate": 9.08282618391128e-06,
      "loss": 0.084,
      "mae_dtheta": 0.012077848426997662,
      "mae_dx": 0.0019443270284682512,
      "mae_dy": 0.0030639050528407097,
      "pose_mae_dtheta": 0.08000355213880539,
      "pose_mae_dx": 0.027534641325473785,
      "pose_mae_dy": 0.03404678404331207,
      "pose_rmse_dtheta": 0.1679690033197403,
      "pose_rmse_dx": 0.06896474212408066,
      "pose_rmse_dy": 0.08050308376550674,
      "pose_rmse_mean": 0.10581227391958237,
      "rmse_dtheta": 0.02401617355644703,
      "rmse_dx": 0.005733497440814972,
      "rmse_dy": 0.006586655508726835,
      "rmse_mean": 0.012112108990550041,
      "rotation_flip": 0.004374159034341574,
      "sparse_tokens": 32105.0,
      "step": 2448,
      "turn_loss": 0.10145272314548492,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.11377996654896859,
      "grad_norm": 0.4289737641811371,
      "learning_rate": 9.08206278598805e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.013300378806889057,
      "mae_dx": 0.00204898021183908,
      "mae_dy": 0.003572634421288967,
      "pose_mae_dtheta": 0.09865202754735947,
      "pose_mae_dx": 0.032980360090732574,
      "pose_mae_dy": 0.04521491378545761,
      "pose_rmse_dtheta": 0.23561052978038788,
      "pose_rmse_dx": 0.08686768263578415,
      "pose_rmse_dy": 0.10480474680662155,
      "pose_rmse_mean": 0.14242765307426453,
      "rmse_dtheta": 0.02608509361743927,
      "rmse_dx": 0.005593228619545698,
      "rmse_dy": 0.007385740522295237,
      "rmse_mean": 0.013021355494856834,
      "rotation_flip": 0.003540519392117858,
      "sparse_tokens": 32073.0,
      "step": 2449,
      "turn_loss": 0.10515614598989487,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.11382642631481138,
      "grad_norm": 0.5651121735572815,
      "learning_rate": 9.081299102603977e-06,
      "loss": 0.1679,
      "mae_dtheta": 0.03227226436138153,
      "mae_dx": 0.017508160322904587,
      "mae_dy": 0.005474597215652466,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5651122331619263,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 124.55931091308594,
      "model/head/act_norm_mean": 101.460693359375,
      "model/head/act_norm_min": 80.92918395996094,
      "model/head/act_over_embed": 69.7247383665395,
      "model/head/grad_frac": 0.10521671921014786,
      "model/head/grad_norm": 0.05945925414562225,
      "model/head/grad_zero_frac": 0.00020019848307128996,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6949951171875,
      "model/head/update_ratio": 0.0010289403144270182,
      "model/head/weight_delta": 5.715837001800537,
      "model/head/weight_delta_rel": 0.10027270764112473,
      "model/head/weight_norm": 57.78688049316406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4153948128223419,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4153948128223419,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4153948128223419,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.285463204359023,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08064492046833038,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04557343199849129,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014803764643147588,
      "model/modality_embedder.encoders.pose/weight_delta": 1.8597586154937744,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06076411157846451,
      "model/modality_embedder.encoders.pose/weight_norm": 30.7850284576416,
      "model/modality_embedder/grad_frac": 0.08064492046833038,
      "model/modality_embedder/grad_norm": 0.04557343199849129,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0014803764643147588,
      "model/modality_embedder/weight_delta": 1.8597586154937744,
      "model/modality_embedder/weight_delta_rel": 0.06076411157846451,
      "model/modality_embedder/weight_norm": 30.7850284576416,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 65.21581268310547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.60841083829365,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.068643569946289,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.536711591352475,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08365243673324585,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04727301374077797,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017103609861806035,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.1914467811584473,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04341704025864601,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.639202117919922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 66.53746795654297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.48619636656746,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.780926704406738,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.139934024339826,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07823890447616577,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.044213760644197464,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00031270174076780677,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015129189705476165,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.4904793500900269,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.051631368696689606,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.224143981933594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 68.04995727539062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.211087859623017,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.99250602722168,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.32529560705619,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07834513485431671,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04427379369735718,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014677883591502905,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.593338966369629,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05350133776664734,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.16360855102539,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 68.59455108642578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.261793154761904,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.85673713684082,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.734559484881093,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07415036112070084,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04190327599644661,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014187933411449194,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.3591973781585693,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.046450916677713394,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.534446716308594,
      "model/normalizer/grad_frac": 0.29809504747390747,
      "model/normalizer/grad_norm": 0.16845716536045074,
      "model/normalizer/grad_zero_frac": 0.00026352767599746585,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002158494433388114,
      "model/normalizer/weight_delta": 2.901134729385376,
      "model/normalizer/weight_delta_rel": 0.037364937365055084,
      "model/normalizer/weight_norm": 78.0438232421875,
      "pose_mae_dtheta": 0.217264324426651,
      "pose_mae_dx": 0.14656773209571838,
      "pose_mae_dy": 0.10150229930877686,
      "pose_rmse_dtheta": 0.3848801851272583,
      "pose_rmse_dx": 0.31069397926330566,
      "pose_rmse_dy": 0.2019936591386795,
      "pose_rmse_mean": 0.2991892695426941,
      "rmse_dtheta": 0.04781945422291756,
      "rmse_dx": 0.03289886564016342,
      "rmse_dy": 0.008696830831468105,
      "rmse_mean": 0.029805053025484085,
      "rotation_flip": 0.0075872535817325115,
      "sparse_tokens": 10845.0,
      "step": 2450,
      "turn_loss": 0.2633504569530487,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.11387288608065416,
      "grad_norm": 0.6331075429916382,
      "learning_rate": 9.080535133812469e-06,
      "loss": 0.1897,
      "mae_dtheta": 0.012231332249939442,
      "mae_dx": 0.002344423206523061,
      "mae_dy": 0.003664689138531685,
      "pose_mae_dtheta": 0.08560262620449066,
      "pose_mae_dx": 0.02789200283586979,
      "pose_mae_dy": 0.036481063812971115,
      "pose_rmse_dtheta": 0.22304385900497437,
      "pose_rmse_dx": 0.08391809463500977,
      "pose_rmse_dy": 0.09310506284236908,
      "pose_rmse_mean": 0.13335567712783813,
      "rmse_dtheta": 0.02690969966351986,
      "rmse_dx": 0.007411920931190252,
      "rmse_dy": 0.009501390159130096,
      "rmse_mean": 0.014607670716941357,
      "rotation_flip": 0.008192524313926697,
      "sparse_tokens": 32041.0,
      "step": 2451,
      "turn_loss": 0.09251223504543304,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11391934584649693,
      "grad_norm": 0.4647437334060669,
      "learning_rate": 9.079770879666948e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.011480550281703472,
      "mae_dx": 0.0021826401352882385,
      "mae_dy": 0.0032163369469344616,
      "pose_mae_dtheta": 0.07389995455741882,
      "pose_mae_dx": 0.028271863237023354,
      "pose_mae_dy": 0.03732611984014511,
      "pose_rmse_dtheta": 0.1346096396446228,
      "pose_rmse_dx": 0.060713618993759155,
      "pose_rmse_dy": 0.07529439777135849,
      "pose_rmse_mean": 0.09020589292049408,
      "rmse_dtheta": 0.020309800282120705,
      "rmse_dx": 0.005834768060594797,
      "rmse_dy": 0.006150192581117153,
      "rmse_mean": 0.010764921084046364,
      "rotation_flip": 0.0028109627310186625,
      "sparse_tokens": 32105.0,
      "step": 2452,
      "turn_loss": 0.11322946101427078,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11396580561233971,
      "grad_norm": 0.5239813327789307,
      "learning_rate": 9.079006340220862e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.014577612280845642,
      "mae_dx": 0.002872083568945527,
      "mae_dy": 0.0038996771909296513,
      "pose_mae_dtheta": 0.10510959476232529,
      "pose_mae_dx": 0.03659849241375923,
      "pose_mae_dy": 0.04338884353637695,
      "pose_rmse_dtheta": 0.23714591562747955,
      "pose_rmse_dx": 0.09764344245195389,
      "pose_rmse_dy": 0.10104691237211227,
      "pose_rmse_mean": 0.14527876675128937,
      "rmse_dtheta": 0.029467744752764702,
      "rmse_dx": 0.007790770847350359,
      "rmse_dy": 0.009860251098871231,
      "rmse_mean": 0.01570625603199005,
      "rotation_flip": 0.0061482819728553295,
      "sparse_tokens": 32137.0,
      "step": 2453,
      "turn_loss": 0.13557250797748566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1140122653781825,
      "grad_norm": 0.5204228758811951,
      "learning_rate": 9.07824151552767e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.007028365042060614,
      "mae_dx": 0.002016788814216852,
      "mae_dy": 0.0014231582172214985,
      "pose_mae_dtheta": 0.04726719111204147,
      "pose_mae_dx": 0.019193630665540695,
      "pose_mae_dy": 0.01852240227162838,
      "pose_rmse_dtheta": 0.15786078572273254,
      "pose_rmse_dx": 0.04940728843212128,
      "pose_rmse_dy": 0.048321664333343506,
      "pose_rmse_mean": 0.08519657701253891,
      "rmse_dtheta": 0.020446807146072388,
      "rmse_dx": 0.006007255986332893,
      "rmse_dy": 0.0036021429114043713,
      "rmse_mean": 0.010018736124038696,
      "rotation_flip": 0.0025367834605276585,
      "sparse_tokens": 32105.0,
      "step": 2454,
      "turn_loss": 0.07741890847682953,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11405872514402528,
      "grad_norm": 0.5562471151351929,
      "learning_rate": 9.077476405640862e-06,
      "loss": 0.151,
      "mae_dtheta": 0.007464705500751734,
      "mae_dx": 0.0021112835966050625,
      "mae_dy": 0.002437120769172907,
      "pose_mae_dtheta": 0.05022810399532318,
      "pose_mae_dx": 0.020826032385230064,
      "pose_mae_dy": 0.023565132170915604,
      "pose_rmse_dtheta": 0.12667351961135864,
      "pose_rmse_dx": 0.058151520788669586,
      "pose_rmse_dy": 0.07204896956682205,
      "pose_rmse_mean": 0.08562466502189636,
      "rmse_dtheta": 0.019055603072047234,
      "rmse_dx": 0.00646374374628067,
      "rmse_dy": 0.008152015507221222,
      "rmse_mean": 0.011223788373172283,
      "rotation_flip": 0.0030487803742289543,
      "sparse_tokens": 32105.0,
      "step": 2455,
      "turn_loss": 0.09001059830188751,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.11410518490986805,
      "grad_norm": 0.5479413270950317,
      "learning_rate": 9.076711010613939e-06,
      "loss": 0.1004,
      "mae_dtheta": 0.010887548327445984,
      "mae_dx": 0.0018375663785263896,
      "mae_dy": 0.002872166922315955,
      "pose_mae_dtheta": 0.0757676362991333,
      "pose_mae_dx": 0.027573786675930023,
      "pose_mae_dy": 0.036101821810007095,
      "pose_rmse_dtheta": 0.1670408397912979,
      "pose_rmse_dx": 0.07820505648851395,
      "pose_rmse_dy": 0.08505208045244217,
      "pose_rmse_mean": 0.11009933054447174,
      "rmse_dtheta": 0.02061016857624054,
      "rmse_dx": 0.005793272517621517,
      "rmse_dy": 0.006712538190186024,
      "rmse_mean": 0.011038660071790218,
      "rotation_flip": 0.006329114083200693,
      "sparse_tokens": 32057.0,
      "step": 2456,
      "turn_loss": 0.08746828883886337,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.11415164467571083,
      "grad_norm": 0.6693305969238281,
      "learning_rate": 9.075945330500428e-06,
      "loss": 0.1085,
      "mae_dtheta": 0.007094386499375105,
      "mae_dx": 0.0017310547409579158,
      "mae_dy": 0.0014170358190312982,
      "pose_mae_dtheta": 0.04912387207150459,
      "pose_mae_dx": 0.0205987561494112,
      "pose_mae_dy": 0.017882943153381348,
      "pose_rmse_dtheta": 0.15168538689613342,
      "pose_rmse_dx": 0.05347490310668945,
      "pose_rmse_dy": 0.05061515048146248,
      "pose_rmse_mean": 0.08525848388671875,
      "rmse_dtheta": 0.019369011744856834,
      "rmse_dx": 0.00437988480553031,
      "rmse_dy": 0.0037506879307329655,
      "rmse_mean": 0.009166528470814228,
      "rotation_flip": 0.0008193363319151103,
      "sparse_tokens": 32169.0,
      "step": 2457,
      "turn_loss": 0.06564593315124512,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.11419810444155361,
      "grad_norm": 0.6336266398429871,
      "learning_rate": 9.075179365353872e-06,
      "loss": 0.1574,
      "mae_dtheta": 0.02168419025838375,
      "mae_dx": 0.009481394663453102,
      "mae_dy": 0.003046903759241104,
      "pose_mae_dtheta": 0.17232072353363037,
      "pose_mae_dx": 0.08517608046531677,
      "pose_mae_dy": 0.05448157712817192,
      "pose_rmse_dtheta": 0.37299245595932007,
      "pose_rmse_dx": 0.22613973915576935,
      "pose_rmse_dy": 0.1222376823425293,
      "pose_rmse_mean": 0.24045662581920624,
      "rmse_dtheta": 0.04090382903814316,
      "rmse_dx": 0.023035945370793343,
      "rmse_dy": 0.005840801168233156,
      "rmse_mean": 0.023260191082954407,
      "rotation_flip": 0.011936339549720287,
      "sparse_tokens": 20993.0,
      "step": 2458,
      "turn_loss": 0.17552341520786285,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.1142445642073964,
      "grad_norm": 0.4317586123943329,
      "learning_rate": 9.074413115227836e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.007216019090265036,
      "mae_dx": 0.0019526733085513115,
      "mae_dy": 0.0011319945333525538,
      "pose_mae_dtheta": 0.05623752623796463,
      "pose_mae_dx": 0.01887604594230652,
      "pose_mae_dy": 0.01725851185619831,
      "pose_rmse_dtheta": 0.1572619080543518,
      "pose_rmse_dx": 0.045451801270246506,
      "pose_rmse_dy": 0.04166927561163902,
      "pose_rmse_mean": 0.08146099746227264,
      "rmse_dtheta": 0.018057027831673622,
      "rmse_dx": 0.005309868138283491,
      "rmse_dy": 0.002328432397916913,
      "rmse_mean": 0.00856511015444994,
      "rotation_flip": 0.0027711796574294567,
      "sparse_tokens": 32217.0,
      "step": 2459,
      "turn_loss": 0.056629762053489685,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.11429102397323918,
      "grad_norm": 0.5415960550308228,
      "learning_rate": 9.073646580175903e-06,
      "loss": 0.101,
      "mae_dtheta": 0.01069581788033247,
      "mae_dx": 0.002068030647933483,
      "mae_dy": 0.001870931126177311,
      "pose_mae_dtheta": 0.06912768632173538,
      "pose_mae_dx": 0.02180107682943344,
      "pose_mae_dy": 0.02282581478357315,
      "pose_rmse_dtheta": 0.15584535896778107,
      "pose_rmse_dx": 0.04918108135461807,
      "pose_rmse_dy": 0.05272359773516655,
      "pose_rmse_mean": 0.0859166830778122,
      "rmse_dtheta": 0.022995533421635628,
      "rmse_dx": 0.005929911509156227,
      "rmse_dy": 0.003906269557774067,
      "rmse_mean": 0.010943904519081116,
      "rotation_flip": 0.006092917174100876,
      "sparse_tokens": 32153.0,
      "step": 2460,
      "turn_loss": 0.07338336855173111,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.11433748373908195,
      "grad_norm": 0.4440884590148926,
      "learning_rate": 9.07287976025168e-06,
      "loss": 0.0864,
      "mae_dtheta": 0.03235567361116409,
      "mae_dx": 0.010626549832522869,
      "mae_dy": 0.003994915168732405,
      "pose_mae_dtheta": 0.25595560669898987,
      "pose_mae_dx": 0.07921484112739563,
      "pose_mae_dy": 0.047471802681684494,
      "pose_rmse_dtheta": 0.42695993185043335,
      "pose_rmse_dx": 0.17567017674446106,
      "pose_rmse_dy": 0.1278580129146576,
      "pose_rmse_mean": 0.24349606037139893,
      "rmse_dtheta": 0.04744909331202507,
      "rmse_dx": 0.022126097232103348,
      "rmse_dy": 0.009184994734823704,
      "rmse_mean": 0.026253394782543182,
      "rotation_flip": 0.015978695824742317,
      "sparse_tokens": 12427.0,
      "step": 2461,
      "turn_loss": 0.21617548167705536,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 27902.0,
      "epoch": 0.11438394350492473,
      "grad_norm": 0.6975821256637573,
      "learning_rate": 9.072112655508786e-06,
      "loss": 0.1313,
      "mae_dtheta": 0.032563675194978714,
      "mae_dx": 0.00984208844602108,
      "mae_dy": 0.00424089515581727,
      "pose_mae_dtheta": 0.22734934091567993,
      "pose_mae_dx": 0.07859085500240326,
      "pose_mae_dy": 0.04255375638604164,
      "pose_rmse_dtheta": 0.42979103326797485,
      "pose_rmse_dx": 0.193278506398201,
      "pose_rmse_dy": 0.104460708796978,
      "pose_rmse_mean": 0.24251008033752441,
      "rmse_dtheta": 0.05261754244565964,
      "rmse_dx": 0.02182927541434765,
      "rmse_dy": 0.010849528945982456,
      "rmse_mean": 0.02843211591243744,
      "rotation_flip": 0.019708653911948204,
      "sparse_tokens": 23450.0,
      "step": 2462,
      "turn_loss": 0.24511390924453735,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11443040327076752,
      "grad_norm": 0.5276716947555542,
      "learning_rate": 9.071345266000872e-06,
      "loss": 0.1681,
      "mae_dtheta": 0.014833156950771809,
      "mae_dx": 0.004112169612199068,
      "mae_dy": 0.003111213678494096,
      "pose_mae_dtheta": 0.10631656646728516,
      "pose_mae_dx": 0.046676214784383774,
      "pose_mae_dy": 0.046289410442113876,
      "pose_rmse_dtheta": 0.24820074439048767,
      "pose_rmse_dx": 0.11672604829072952,
      "pose_rmse_dy": 0.11923666298389435,
      "pose_rmse_mean": 0.1613878309726715,
      "rmse_dtheta": 0.030718958005309105,
      "rmse_dx": 0.012139145284891129,
      "rmse_dy": 0.0074606165289878845,
      "rmse_mean": 0.016772907227277756,
      "rotation_flip": 0.007264957297593355,
      "sparse_tokens": 32089.0,
      "step": 2463,
      "turn_loss": 0.1535869687795639,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1144768630366103,
      "grad_norm": 0.6225287914276123,
      "learning_rate": 9.070577591781598e-06,
      "loss": 0.128,
      "mae_dtheta": 0.011160365305840969,
      "mae_dx": 0.0015809001633897424,
      "mae_dy": 0.0012977164005860686,
      "pose_mae_dtheta": 0.07628300786018372,
      "pose_mae_dx": 0.016146523877978325,
      "pose_mae_dy": 0.01911294460296631,
      "pose_rmse_dtheta": 0.24581679701805115,
      "pose_rmse_dx": 0.03962559625506401,
      "pose_rmse_dy": 0.045137230306863785,
      "pose_rmse_mean": 0.11019320785999298,
      "rmse_dtheta": 0.029510466381907463,
      "rmse_dx": 0.004609329625964165,
      "rmse_dy": 0.003043098608031869,
      "rmse_mean": 0.012387632392346859,
      "rotation_flip": 0.004882018081843853,
      "sparse_tokens": 32169.0,
      "step": 2464,
      "turn_loss": 0.0688464492559433,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.11452332280245307,
      "grad_norm": 0.5284611582756042,
      "learning_rate": 9.069809632904647e-06,
      "loss": 0.1641,
      "mae_dtheta": 0.03466875106096268,
      "mae_dx": 0.01197557058185339,
      "mae_dy": 0.008784404024481773,
      "pose_mae_dtheta": 0.2378048449754715,
      "pose_mae_dx": 0.11367987096309662,
      "pose_mae_dy": 0.0899050384759903,
      "pose_rmse_dtheta": 0.37380900979042053,
      "pose_rmse_dx": 0.23895414173603058,
      "pose_rmse_dy": 0.20984256267547607,
      "pose_rmse_mean": 0.2742019295692444,
      "rmse_dtheta": 0.04991484433412552,
      "rmse_dx": 0.02338588237762451,
      "rmse_dy": 0.016872912645339966,
      "rmse_mean": 0.0300578810274601,
      "rotation_flip": 0.019059721380472183,
      "sparse_tokens": 13576.0,
      "step": 2465,
      "turn_loss": 0.3431796431541443,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.11456978256829585,
      "grad_norm": 0.46751371026039124,
      "learning_rate": 9.069041389423722e-06,
      "loss": 0.1821,
      "mae_dtheta": 0.04084458202123642,
      "mae_dx": 0.018808137625455856,
      "mae_dy": 0.005101427435874939,
      "pose_mae_dtheta": 0.3432079553604126,
      "pose_mae_dx": 0.14343415200710297,
      "pose_mae_dy": 0.07740800827741623,
      "pose_rmse_dtheta": 0.53644859790802,
      "pose_rmse_dx": 0.2771492302417755,
      "pose_rmse_dy": 0.149114727973938,
      "pose_rmse_mean": 0.3209041953086853,
      "rmse_dtheta": 0.05333492532372475,
      "rmse_dx": 0.032565806061029434,
      "rmse_dy": 0.007925746962428093,
      "rmse_mean": 0.03127549588680267,
      "rotation_flip": 0.006825938355177641,
      "sparse_tokens": 5130.0,
      "step": 2466,
      "turn_loss": 0.3831116557121277,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11461624233413864,
      "grad_norm": 0.46821823716163635,
      "learning_rate": 9.06827286139255e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.01502367202192545,
      "mae_dx": 0.002807018579915166,
      "mae_dy": 0.004899843130260706,
      "pose_mae_dtheta": 0.09672962874174118,
      "pose_mae_dx": 0.03864727541804314,
      "pose_mae_dy": 0.045123785734176636,
      "pose_rmse_dtheta": 0.18068711459636688,
      "pose_rmse_dx": 0.0914602130651474,
      "pose_rmse_dy": 0.08955758810043335,
      "pose_rmse_mean": 0.12056830525398254,
      "rmse_dtheta": 0.025245362892746925,
      "rmse_dx": 0.007355707697570324,
      "rmse_dy": 0.009030147455632687,
      "rmse_mean": 0.013877073302865028,
      "rotation_flip": 0.006246281787753105,
      "sparse_tokens": 32105.0,
      "step": 2467,
      "turn_loss": 0.12320706248283386,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11466270209998142,
      "grad_norm": 0.6868131756782532,
      "learning_rate": 9.067504048864875e-06,
      "loss": 0.1544,
      "mae_dtheta": 0.009614785201847553,
      "mae_dx": 0.001910585444420576,
      "mae_dy": 0.0017765720840543509,
      "pose_mae_dtheta": 0.0725550726056099,
      "pose_mae_dx": 0.02298710308969021,
      "pose_mae_dy": 0.025345945730805397,
      "pose_rmse_dtheta": 0.20142577588558197,
      "pose_rmse_dx": 0.0715927928686142,
      "pose_rmse_dy": 0.08241064101457596,
      "pose_rmse_mean": 0.11847640573978424,
      "rmse_dtheta": 0.022918086498975754,
      "rmse_dx": 0.005683716386556625,
      "rmse_dy": 0.004984604194760323,
      "rmse_mean": 0.011195468716323376,
      "rotation_flip": 0.003813155461102724,
      "sparse_tokens": 32121.0,
      "step": 2468,
      "turn_loss": 0.06262713670730591,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.1147091618658242,
      "grad_norm": 0.3955356776714325,
      "learning_rate": 9.066734951894458e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.03341807797551155,
      "mae_dx": 0.014693699777126312,
      "mae_dy": 0.0038877699989825487,
      "pose_mae_dtheta": 0.26858165860176086,
      "pose_mae_dx": 0.1222611740231514,
      "pose_mae_dy": 0.04607579857110977,
      "pose_rmse_dtheta": 0.4507702887058258,
      "pose_rmse_dx": 0.26145270466804504,
      "pose_rmse_dy": 0.11510640382766724,
      "pose_rmse_mean": 0.2757764756679535,
      "rmse_dtheta": 0.04895356297492981,
      "rmse_dx": 0.027566859498620033,
      "rmse_dy": 0.007644156459718943,
      "rmse_mean": 0.0280548594892025,
      "rotation_flip": 0.013828868046402931,
      "sparse_tokens": 20394.0,
      "step": 2469,
      "turn_loss": 0.27276790142059326,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 25879.0,
      "epoch": 0.11475562163166697,
      "grad_norm": 0.7339268922805786,
      "learning_rate": 9.065965570535083e-06,
      "loss": 0.1998,
      "mae_dtheta": 0.03942273557186127,
      "mae_dx": 0.01436543744057417,
      "mae_dy": 0.005538220517337322,
      "pose_mae_dtheta": 0.3350600302219391,
      "pose_mae_dx": 0.12166580557823181,
      "pose_mae_dy": 0.06320629268884659,
      "pose_rmse_dtheta": 0.5589014291763306,
      "pose_rmse_dx": 0.24576345086097717,
      "pose_rmse_dy": 0.133220374584198,
      "pose_rmse_mean": 0.3126284182071686,
      "rmse_dtheta": 0.05687927082180977,
      "rmse_dx": 0.02654346264898777,
      "rmse_dy": 0.01018560491502285,
      "rmse_mean": 0.031202781945466995,
      "rotation_flip": 0.015342960134148598,
      "sparse_tokens": 20291.0,
      "step": 2470,
      "turn_loss": 0.35735052824020386,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11480208139750976,
      "grad_norm": 0.5881352424621582,
      "learning_rate": 9.065195904840553e-06,
      "loss": 0.1053,
      "mae_dtheta": 0.012241680175065994,
      "mae_dx": 0.0018623939249664545,
      "mae_dy": 0.0026439419016242027,
      "pose_mae_dtheta": 0.08312654495239258,
      "pose_mae_dx": 0.019999373704195023,
      "pose_mae_dy": 0.030898213386535645,
      "pose_rmse_dtheta": 0.2182360291481018,
      "pose_rmse_dx": 0.05082584545016289,
      "pose_rmse_dy": 0.06847014278173447,
      "pose_rmse_mean": 0.11251067370176315,
      "rmse_dtheta": 0.027453957125544548,
      "rmse_dx": 0.006330713164061308,
      "rmse_dy": 0.0067879315465688705,
      "rmse_mean": 0.013524199835956097,
      "rotation_flip": 0.006168080028146505,
      "sparse_tokens": 32089.0,
      "step": 2471,
      "turn_loss": 0.08513931185007095,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.11484854116335254,
      "grad_norm": 0.5317717790603638,
      "learning_rate": 9.064425954864691e-06,
      "loss": 0.1072,
      "mae_dtheta": 0.010827251709997654,
      "mae_dx": 0.0017873201286420226,
      "mae_dy": 0.002864501439034939,
      "pose_mae_dtheta": 0.07253310829401016,
      "pose_mae_dx": 0.02358306013047695,
      "pose_mae_dy": 0.03794112056493759,
      "pose_rmse_dtheta": 0.14773306250572205,
      "pose_rmse_dx": 0.054768238216638565,
      "pose_rmse_dy": 0.08348753303289413,
      "pose_rmse_mean": 0.09532961249351501,
      "rmse_dtheta": 0.02102833054959774,
      "rmse_dx": 0.005080516915768385,
      "rmse_dy": 0.005753397475928068,
      "rmse_mean": 0.01062074862420559,
      "rotation_flip": 0.009263343177735806,
      "sparse_tokens": 32057.0,
      "step": 2472,
      "turn_loss": 0.09563831984996796,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31047.0,
      "epoch": 0.11489500092919532,
      "grad_norm": 0.8469804525375366,
      "learning_rate": 9.06365572066134e-06,
      "loss": 0.2459,
      "mae_dtheta": 0.039718274027109146,
      "mae_dx": 0.015271476469933987,
      "mae_dy": 0.00503995968028903,
      "pose_mae_dtheta": 0.33509930968284607,
      "pose_mae_dx": 0.13341426849365234,
      "pose_mae_dy": 0.06517978757619858,
      "pose_rmse_dtheta": 0.5643243193626404,
      "pose_rmse_dx": 0.27585235238075256,
      "pose_rmse_dy": 0.18054363131523132,
      "pose_rmse_mean": 0.34024012088775635,
      "rmse_dtheta": 0.05767744779586792,
      "rmse_dx": 0.028395986184477806,
      "rmse_dy": 0.010749145410954952,
      "rmse_mean": 0.032274194061756134,
      "rotation_flip": 0.0078125,
      "sparse_tokens": 24177.0,
      "step": 2473,
      "turn_loss": 0.32771727442741394,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.11494146069503809,
      "grad_norm": 0.8190574049949646,
      "learning_rate": 9.062885202284365e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.026285255327820778,
      "mae_dx": 0.0047574411146342754,
      "mae_dy": 0.004757024347782135,
      "pose_mae_dtheta": 0.19774229824543,
      "pose_mae_dx": 0.043745916336774826,
      "pose_mae_dy": 0.0670989379286766,
      "pose_rmse_dtheta": 0.38589465618133545,
      "pose_rmse_dx": 0.10735410451889038,
      "pose_rmse_dy": 0.16578784584999084,
      "pose_rmse_mean": 0.2196788787841797,
      "rmse_dtheta": 0.045262422412633896,
      "rmse_dx": 0.01312575489282608,
      "rmse_dy": 0.012263160198926926,
      "rmse_mean": 0.023550447076559067,
      "rotation_flip": 0.005797101650387049,
      "sparse_tokens": 5983.0,
      "step": 2474,
      "turn_loss": 0.20192593336105347,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11498792046088088,
      "grad_norm": 0.6757946610450745,
      "learning_rate": 9.062114399787648e-06,
      "loss": 0.1159,
      "mae_dtheta": 0.013793522492051125,
      "mae_dx": 0.0019644007552415133,
      "mae_dy": 0.0024605875369161367,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6757946610450745,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.31658935546875,
      "model/head/act_norm_mean": 111.49031328914141,
      "model/head/act_norm_min": 61.523250579833984,
      "model/head/act_over_embed": 76.61718708105614,
      "model/head/grad_frac": 0.11461105197668076,
      "model/head/grad_norm": 0.07745353877544403,
      "model/head/grad_zero_frac": 0.0001649813202675432,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6855370107323232,
      "model/head/update_ratio": 0.0013401672476902604,
      "model/head/weight_delta": 5.750598907470703,
      "model/head/weight_delta_rel": 0.10088253766298294,
      "model/head/weight_norm": 57.7939338684082,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4155730903148651,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41551140679253473,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41542550921440125,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28554332882690947,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06639918684959412,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0448722168803215,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5238975694444444,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014575396198779345,
      "model/modality_embedder.encoders.pose/weight_delta": 1.8726593255996704,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06118561699986458,
      "model/modality_embedder.encoders.pose/weight_norm": 30.78627586364746,
      "model/modality_embedder/grad_frac": 0.06639918684959412,
      "model/modality_embedder/grad_norm": 0.0448722168803215,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5238975694444444,
      "model/modality_embedder/update_ratio": 0.0014575396198779345,
      "model/modality_embedder/weight_delta": 1.8726593255996704,
      "model/modality_embedder/weight_delta_rel": 0.06118561699986458,
      "model/modality_embedder/weight_norm": 30.78627586364746,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.28531646728516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.624073071989738,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.068294525146484,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.23468418712807,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08629562705755234,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0583181232213974,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002109820954501629,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.201456069946289,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04378178343176842,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.641267776489258,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.6626205444336,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.687933401475068,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.511820793151855,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.965778965567715,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09388329088687897,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06344582885503769,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0021707627456635237,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.5043033361434937,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05211024358868599,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.227436065673828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.41454315185547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.639597863556197,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.754433631896973,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.30698105568044,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10689065605401993,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07223613560199738,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0023945122957229614,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.608047604560852,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05399522930383682,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.167369842529297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.2932357788086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.486501924001924,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.489619255065918,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.57619081700698,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12822225689888,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08665191382169724,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002933625830337405,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.3720121383666992,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.046888865530490875,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.537479400634766,
      "model/normalizer/grad_frac": 0.44695791602134705,
      "model/normalizer/grad_norm": 0.3020517826080322,
      "model/normalizer/grad_zero_frac": 0.00011817384074674919,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003870086744427681,
      "model/normalizer/weight_delta": 2.9274611473083496,
      "model/normalizer/weight_delta_rel": 0.03770400583744049,
      "model/normalizer/weight_norm": 78.04780578613281,
      "pose_mae_dtheta": 0.09785307943820953,
      "pose_mae_dx": 0.027749434113502502,
      "pose_mae_dy": 0.03261137753725052,
      "pose_rmse_dtheta": 0.2566332519054413,
      "pose_rmse_dx": 0.06826002895832062,
      "pose_rmse_dy": 0.07516656816005707,
      "pose_rmse_mean": 0.13335329294204712,
      "rmse_dtheta": 0.029578790068626404,
      "rmse_dx": 0.005607187282294035,
      "rmse_dy": 0.005102821160107851,
      "rmse_mean": 0.013429599814116955,
      "rotation_flip": 0.005313092842698097,
      "sparse_tokens": 32121.0,
      "step": 2475,
      "turn_loss": 0.0956609696149826,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11503438022672366,
      "grad_norm": 0.4188973009586334,
      "learning_rate": 9.061343313225088e-06,
      "loss": 0.109,
      "mae_dtheta": 0.008504724130034447,
      "mae_dx": 0.0014469291782006621,
      "mae_dy": 0.0015662480145692825,
      "pose_mae_dtheta": 0.060385119169950485,
      "pose_mae_dx": 0.014757371507585049,
      "pose_mae_dy": 0.022252768278121948,
      "pose_rmse_dtheta": 0.13146883249282837,
      "pose_rmse_dx": 0.036561816930770874,
      "pose_rmse_dy": 0.04546894505620003,
      "pose_rmse_mean": 0.07116653025150299,
      "rmse_dtheta": 0.016427353024482727,
      "rmse_dx": 0.0045492141507565975,
      "rmse_dy": 0.0033942274749279022,
      "rmse_mean": 0.008123598992824554,
      "rotation_flip": 0.004771371837705374,
      "sparse_tokens": 32137.0,
      "step": 2476,
      "turn_loss": 0.06328240036964417,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11508083999256644,
      "grad_norm": 0.47819557785987854,
      "learning_rate": 9.06057194265061e-06,
      "loss": 0.1359,
      "mae_dtheta": 0.012269224040210247,
      "mae_dx": 0.0018503328319638968,
      "mae_dy": 0.00280603370629251,
      "pose_mae_dtheta": 0.08657877892255783,
      "pose_mae_dx": 0.02722380869090557,
      "pose_mae_dy": 0.03279038518667221,
      "pose_rmse_dtheta": 0.21344082057476044,
      "pose_rmse_dx": 0.06985678523778915,
      "pose_rmse_dy": 0.07044023275375366,
      "pose_rmse_mean": 0.11791261285543442,
      "rmse_dtheta": 0.025596605613827705,
      "rmse_dx": 0.0051989201456308365,
      "rmse_dy": 0.006041537970304489,
      "rmse_mean": 0.012279021553695202,
      "rotation_flip": 0.006859205663204193,
      "sparse_tokens": 32121.0,
      "step": 2477,
      "turn_loss": 0.08641236275434494,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.11512729975840921,
      "grad_norm": 0.5754982829093933,
      "learning_rate": 9.05980028811816e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.009587898850440979,
      "mae_dx": 0.002059204736724496,
      "mae_dy": 0.0017125689191743731,
      "pose_mae_dtheta": 0.06421183049678802,
      "pose_mae_dx": 0.019674118608236313,
      "pose_mae_dy": 0.020336171612143517,
      "pose_rmse_dtheta": 0.15509574115276337,
      "pose_rmse_dx": 0.04614701122045517,
      "pose_rmse_dy": 0.04978879168629646,
      "pose_rmse_mean": 0.08367718756198883,
      "rmse_dtheta": 0.02187247760593891,
      "rmse_dx": 0.005896794144064188,
      "rmse_dy": 0.0038867418188601732,
      "rmse_mean": 0.010552003979682922,
      "rotation_flip": 0.0036023054271936417,
      "sparse_tokens": 32217.0,
      "step": 2478,
      "turn_loss": 0.0734160840511322,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18451.0,
      "epoch": 0.115173759524252,
      "grad_norm": 0.4969237148761749,
      "learning_rate": 9.059028349681693e-06,
      "loss": 0.1028,
      "mae_dtheta": 0.03313293680548668,
      "mae_dx": 0.012637454085052013,
      "mae_dy": 0.005717097315937281,
      "pose_mae_dtheta": 0.23863162100315094,
      "pose_mae_dx": 0.10032612830400467,
      "pose_mae_dy": 0.07464194297790527,
      "pose_rmse_dtheta": 0.40501898527145386,
      "pose_rmse_dx": 0.2353142499923706,
      "pose_rmse_dy": 0.14778438210487366,
      "pose_rmse_mean": 0.26270589232444763,
      "rmse_dtheta": 0.04749083146452904,
      "rmse_dx": 0.02649747021496296,
      "rmse_dy": 0.00973767414689064,
      "rmse_mean": 0.027908658608794212,
      "rotation_flip": 0.024705883115530014,
      "sparse_tokens": 14643.0,
      "step": 2479,
      "turn_loss": 0.26413244009017944,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11522021929009478,
      "grad_norm": 0.6195133328437805,
      "learning_rate": 9.058256127395198e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.016016002744436264,
      "mae_dx": 0.003805179614573717,
      "mae_dy": 0.006342817563563585,
      "pose_mae_dtheta": 0.1098526120185852,
      "pose_mae_dx": 0.05275009945034981,
      "pose_mae_dy": 0.053808655589818954,
      "pose_rmse_dtheta": 0.22057825326919556,
      "pose_rmse_dx": 0.13922040164470673,
      "pose_rmse_dy": 0.11573344469070435,
      "pose_rmse_mean": 0.1585107147693634,
      "rmse_dtheta": 0.027945391833782196,
      "rmse_dx": 0.009546327404677868,
      "rmse_dy": 0.012565730139613152,
      "rmse_mean": 0.016685817390680313,
      "rotation_flip": 0.005989817436784506,
      "sparse_tokens": 32121.0,
      "step": 2480,
      "turn_loss": 0.14980557560920715,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11526667905593756,
      "grad_norm": 0.6407728791236877,
      "learning_rate": 9.057483621312671e-06,
      "loss": 0.0894,
      "mae_dtheta": 0.009273232892155647,
      "mae_dx": 0.0015681629301980138,
      "mae_dy": 0.001357092522084713,
      "pose_mae_dtheta": 0.06754275411367416,
      "pose_mae_dx": 0.016795244067907333,
      "pose_mae_dy": 0.016633393242955208,
      "pose_rmse_dtheta": 0.2173546850681305,
      "pose_rmse_dx": 0.04876786842942238,
      "pose_rmse_dy": 0.05068189650774002,
      "pose_rmse_mean": 0.1056014820933342,
      "rmse_dtheta": 0.0252801775932312,
      "rmse_dx": 0.005191292148083448,
      "rmse_dy": 0.0031675631180405617,
      "rmse_mean": 0.011213011108338833,
      "rotation_flip": 0.0020418581552803516,
      "sparse_tokens": 32105.0,
      "step": 2481,
      "turn_loss": 0.060226961970329285,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.11531313882178033,
      "grad_norm": 0.6669646501541138,
      "learning_rate": 9.056710831488138e-06,
      "loss": 0.1333,
      "mae_dtheta": 0.0167388916015625,
      "mae_dx": 0.0032771448604762554,
      "mae_dy": 0.0038795536383986473,
      "pose_mae_dtheta": 0.11574508994817734,
      "pose_mae_dx": 0.04272644221782684,
      "pose_mae_dy": 0.04381889849901199,
      "pose_rmse_dtheta": 0.2537985146045685,
      "pose_rmse_dx": 0.10169600695371628,
      "pose_rmse_dy": 0.09539815783500671,
      "pose_rmse_mean": 0.15029756724834442,
      "rmse_dtheta": 0.03155360370874405,
      "rmse_dx": 0.009179066866636276,
      "rmse_dy": 0.007433651480823755,
      "rmse_mean": 0.01605544239282608,
      "rotation_flip": 0.005173688288778067,
      "sparse_tokens": 32057.0,
      "step": 2482,
      "turn_loss": 0.14540384709835052,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11535959858762312,
      "grad_norm": 0.4713667333126068,
      "learning_rate": 9.05593775797564e-06,
      "loss": 0.0754,
      "mae_dtheta": 0.009224755689501762,
      "mae_dx": 0.0014480312820523977,
      "mae_dy": 0.002032250864431262,
      "pose_mae_dtheta": 0.06477691233158112,
      "pose_mae_dx": 0.021914193406701088,
      "pose_mae_dy": 0.02855280227959156,
      "pose_rmse_dtheta": 0.14000020921230316,
      "pose_rmse_dx": 0.05402808263897896,
      "pose_rmse_dy": 0.07024955749511719,
      "pose_rmse_mean": 0.0880926176905632,
      "rmse_dtheta": 0.01932504214346409,
      "rmse_dx": 0.004866075236350298,
      "rmse_dy": 0.004336782731115818,
      "rmse_mean": 0.00950930081307888,
      "rotation_flip": 0.00378310214728117,
      "sparse_tokens": 32089.0,
      "step": 2483,
      "turn_loss": 0.06633393466472626,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1154060583534659,
      "grad_norm": 0.7174180746078491,
      "learning_rate": 9.055164400829237e-06,
      "loss": 0.1571,
      "mae_dtheta": 0.00838810671120882,
      "mae_dx": 0.0016031796112656593,
      "mae_dy": 0.0015698865754529834,
      "pose_mae_dtheta": 0.06557022035121918,
      "pose_mae_dx": 0.019634785130620003,
      "pose_mae_dy": 0.02406788058578968,
      "pose_rmse_dtheta": 0.17728908360004425,
      "pose_rmse_dx": 0.05173961818218231,
      "pose_rmse_dy": 0.06274142861366272,
      "pose_rmse_mean": 0.09725671261548996,
      "rmse_dtheta": 0.01926901750266552,
      "rmse_dx": 0.005718450993299484,
      "rmse_dy": 0.0032046218402683735,
      "rmse_mean": 0.009397363290190697,
      "rotation_flip": 0.005166744813323021,
      "sparse_tokens": 32073.0,
      "step": 2484,
      "turn_loss": 0.07039164751768112,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.11545251811930868,
      "grad_norm": 0.5110840201377869,
      "learning_rate": 9.05439076010301e-06,
      "loss": 0.0915,
      "mae_dtheta": 0.007156838197261095,
      "mae_dx": 0.003342595649883151,
      "mae_dy": 0.0011967223836109042,
      "pose_mae_dtheta": 0.05047537013888359,
      "pose_mae_dx": 0.032562799751758575,
      "pose_mae_dy": 0.016850845888257027,
      "pose_rmse_dtheta": 0.16043396294116974,
      "pose_rmse_dx": 0.11480534076690674,
      "pose_rmse_dy": 0.043023593723773956,
      "pose_rmse_mean": 0.10608762502670288,
      "rmse_dtheta": 0.01939750835299492,
      "rmse_dx": 0.011488247662782669,
      "rmse_dy": 0.0027394548524171114,
      "rmse_mean": 0.01120840385556221,
      "rotation_flip": 0.0036855037324130535,
      "sparse_tokens": 32073.0,
      "step": 2485,
      "turn_loss": 0.09202880412340164,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11549897788515145,
      "grad_norm": 0.6036978960037231,
      "learning_rate": 9.053616835851062e-06,
      "loss": 0.1032,
      "mae_dtheta": 0.016332080587744713,
      "mae_dx": 0.0027283988893032074,
      "mae_dy": 0.004913549870252609,
      "pose_mae_dtheta": 0.1187848225235939,
      "pose_mae_dx": 0.04389737918972969,
      "pose_mae_dy": 0.05682944506406784,
      "pose_rmse_dtheta": 0.22409556806087494,
      "pose_rmse_dx": 0.10538017004728317,
      "pose_rmse_dy": 0.13580411672592163,
      "pose_rmse_mean": 0.15509328246116638,
      "rmse_dtheta": 0.027317116037011147,
      "rmse_dx": 0.006599219050258398,
      "rmse_dy": 0.009245174005627632,
      "rmse_mean": 0.014387170784175396,
      "rotation_flip": 0.00541353365406394,
      "sparse_tokens": 32121.0,
      "step": 2486,
      "turn_loss": 0.14499998092651367,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32438.0,
      "epoch": 0.11554543765099425,
      "grad_norm": 0.6893863081932068,
      "learning_rate": 9.052842628127513e-06,
      "loss": 0.2374,
      "mae_dtheta": 0.041241031140089035,
      "mae_dx": 0.010402782820165157,
      "mae_dy": 0.006643957458436489,
      "pose_mae_dtheta": 0.30868256092071533,
      "pose_mae_dx": 0.08981747180223465,
      "pose_mae_dy": 0.07912607491016388,
      "pose_rmse_dtheta": 0.5441451072692871,
      "pose_rmse_dx": 0.19886519014835358,
      "pose_rmse_dy": 0.18686912953853607,
      "pose_rmse_mean": 0.3099598288536072,
      "rmse_dtheta": 0.06192854046821594,
      "rmse_dx": 0.02163848839700222,
      "rmse_dy": 0.014485921710729599,
      "rmse_mean": 0.0326843187212944,
      "rotation_flip": 0.017555706202983856,
      "sparse_tokens": 21982.0,
      "step": 2487,
      "turn_loss": 0.26717230677604675,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.11559189741683702,
      "grad_norm": 0.5223254561424255,
      "learning_rate": 9.052068136986503e-06,
      "loss": 0.1295,
      "mae_dtheta": 0.036566223949193954,
      "mae_dx": 0.01086338423192501,
      "mae_dy": 0.0041623907163739204,
      "pose_mae_dtheta": 0.3061572015285492,
      "pose_mae_dx": 0.0805811733007431,
      "pose_mae_dy": 0.044357262551784515,
      "pose_rmse_dtheta": 0.5262707471847534,
      "pose_rmse_dx": 0.17129400372505188,
      "pose_rmse_dy": 0.11834873259067535,
      "pose_rmse_mean": 0.2719711661338806,
      "rmse_dtheta": 0.056028567254543304,
      "rmse_dx": 0.021313203498721123,
      "rmse_dy": 0.00894699152559042,
      "rmse_mean": 0.028762921690940857,
      "rotation_flip": 0.009057970717549324,
      "sparse_tokens": 9425.0,
      "step": 2488,
      "turn_loss": 0.2809334993362427,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1156383571826798,
      "grad_norm": 0.44494205713272095,
      "learning_rate": 9.051293362482193e-06,
      "loss": 0.0823,
      "mae_dtheta": 0.006256723776459694,
      "mae_dx": 0.0013263222062960267,
      "mae_dy": 0.0010665380395948887,
      "pose_mae_dtheta": 0.044736750423908234,
      "pose_mae_dx": 0.014272098429501057,
      "pose_mae_dy": 0.0153221245855093,
      "pose_rmse_dtheta": 0.13322027027606964,
      "pose_rmse_dx": 0.04064840450882912,
      "pose_rmse_dy": 0.04535144567489624,
      "pose_rmse_mean": 0.0730733722448349,
      "rmse_dtheta": 0.018010491505265236,
      "rmse_dx": 0.004678590688854456,
      "rmse_dy": 0.0023740234319120646,
      "rmse_mean": 0.0083543686196208,
      "rotation_flip": 0.0018507094355300069,
      "sparse_tokens": 32105.0,
      "step": 2489,
      "turn_loss": 0.041965700685977936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.11568481694852258,
      "grad_norm": 0.7164433002471924,
      "learning_rate": 9.050518304668764e-06,
      "loss": 0.1853,
      "mae_dtheta": 0.03261810541152954,
      "mae_dx": 0.014157947152853012,
      "mae_dy": 0.004441149067133665,
      "pose_mae_dtheta": 0.2581917941570282,
      "pose_mae_dx": 0.1026228815317154,
      "pose_mae_dy": 0.05702395737171173,
      "pose_rmse_dtheta": 0.4863923490047455,
      "pose_rmse_dx": 0.21924957633018494,
      "pose_rmse_dy": 0.12391746789216995,
      "pose_rmse_mean": 0.2765198051929474,
      "rmse_dtheta": 0.049610670655965805,
      "rmse_dx": 0.025986704975366592,
      "rmse_dy": 0.008426550775766373,
      "rmse_mean": 0.028007974848151207,
      "rotation_flip": 0.016455696895718575,
      "sparse_tokens": 14999.0,
      "step": 2490,
      "turn_loss": 0.2562081813812256,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11573127671436537,
      "grad_norm": 0.401225745677948,
      "learning_rate": 9.04974296360042e-06,
      "loss": 0.1263,
      "mae_dtheta": 0.010874100029468536,
      "mae_dx": 0.001747378264553845,
      "mae_dy": 0.002663045423105359,
      "pose_mae_dtheta": 0.0766202062368393,
      "pose_mae_dx": 0.022978127002716064,
      "pose_mae_dy": 0.03810494765639305,
      "pose_rmse_dtheta": 0.13058120012283325,
      "pose_rmse_dx": 0.05074804276227951,
      "pose_rmse_dy": 0.07817675918340683,
      "pose_rmse_mean": 0.08650200814008713,
      "rmse_dtheta": 0.01833713799715042,
      "rmse_dx": 0.005071619991213083,
      "rmse_dy": 0.004726945422589779,
      "rmse_mean": 0.009378567337989807,
      "rotation_flip": 0.003619611728936434,
      "sparse_tokens": 32105.0,
      "step": 2491,
      "turn_loss": 0.08590835332870483,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.11577773648020814,
      "grad_norm": 0.533116340637207,
      "learning_rate": 9.048967339331372e-06,
      "loss": 0.1785,
      "mae_dtheta": 0.036325640976428986,
      "mae_dx": 0.012946703471243382,
      "mae_dy": 0.0053498526103794575,
      "pose_mae_dtheta": 0.3072127103805542,
      "pose_mae_dx": 0.1219281405210495,
      "pose_mae_dy": 0.09114771336317062,
      "pose_rmse_dtheta": 0.5056930780410767,
      "pose_rmse_dx": 0.24835070967674255,
      "pose_rmse_dy": 0.19087055325508118,
      "pose_rmse_mean": 0.3149714469909668,
      "rmse_dtheta": 0.050900138914585114,
      "rmse_dx": 0.026579901576042175,
      "rmse_dy": 0.009212270379066467,
      "rmse_mean": 0.028897438198328018,
      "rotation_flip": 0.016771487891674042,
      "sparse_tokens": 9290.0,
      "step": 2492,
      "turn_loss": 0.28518348932266235,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.11582419624605092,
      "grad_norm": 0.6147639751434326,
      "learning_rate": 9.048191431915865e-06,
      "loss": 0.2047,
      "mae_dtheta": 0.010307103395462036,
      "mae_dx": 0.0018960986053571105,
      "mae_dy": 0.001564596313983202,
      "pose_mae_dtheta": 0.07646580785512924,
      "pose_mae_dx": 0.020348412916064262,
      "pose_mae_dy": 0.026537450030446053,
      "pose_rmse_dtheta": 0.20042167603969574,
      "pose_rmse_dx": 0.058367736637592316,
      "pose_rmse_dy": 0.0722317025065422,
      "pose_rmse_mean": 0.11034037917852402,
      "rmse_dtheta": 0.02301073633134365,
      "rmse_dx": 0.006165596656501293,
      "rmse_dy": 0.003441991051658988,
      "rmse_mean": 0.010872773826122284,
      "rotation_flip": 0.002097535412758589,
      "sparse_tokens": 32073.0,
      "step": 2493,
      "turn_loss": 0.06892033666372299,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25879.0,
      "epoch": 0.1158706560118937,
      "grad_norm": 0.5521754026412964,
      "learning_rate": 9.04741524140816e-06,
      "loss": 0.1362,
      "mae_dtheta": 0.030407071113586426,
      "mae_dx": 0.011221916414797306,
      "mae_dy": 0.00515119731426239,
      "pose_mae_dtheta": 0.23224274814128876,
      "pose_mae_dx": 0.0891561210155487,
      "pose_mae_dy": 0.059072911739349365,
      "pose_rmse_dtheta": 0.4333072006702423,
      "pose_rmse_dx": 0.2008448988199234,
      "pose_rmse_dy": 0.15292510390281677,
      "pose_rmse_mean": 0.262359082698822,
      "rmse_dtheta": 0.04763805866241455,
      "rmse_dx": 0.02305811271071434,
      "rmse_dy": 0.011431149207055569,
      "rmse_mean": 0.027375776320695877,
      "rotation_flip": 0.008912655524909496,
      "sparse_tokens": 21202.0,
      "step": 2494,
      "turn_loss": 0.2538984417915344,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11591711577773647,
      "grad_norm": 0.7517790198326111,
      "learning_rate": 9.046638767862534e-06,
      "loss": 0.1613,
      "mae_dtheta": 0.013385043479502201,
      "mae_dx": 0.002241983078420162,
      "mae_dy": 0.0031536065507680178,
      "pose_mae_dtheta": 0.08367625623941422,
      "pose_mae_dx": 0.0327010378241539,
      "pose_mae_dy": 0.039293322712183,
      "pose_rmse_dtheta": 0.16679497063159943,
      "pose_rmse_dx": 0.07152526080608368,
      "pose_rmse_dy": 0.09696046262979507,
      "pose_rmse_mean": 0.1117602288722992,
      "rmse_dtheta": 0.025454340502619743,
      "rmse_dx": 0.005578653421252966,
      "rmse_dy": 0.006239011883735657,
      "rmse_mean": 0.012424002401530743,
      "rotation_flip": 0.006926121190190315,
      "sparse_tokens": 32121.0,
      "step": 2495,
      "turn_loss": 0.1149127259850502,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.11596357554357926,
      "grad_norm": 0.5431281328201294,
      "learning_rate": 9.045862011333286e-06,
      "loss": 0.097,
      "mae_dtheta": 0.010678725317120552,
      "mae_dx": 0.002577605890110135,
      "mae_dy": 0.0018974357517436147,
      "pose_mae_dtheta": 0.07182248681783676,
      "pose_mae_dx": 0.025791844353079796,
      "pose_mae_dy": 0.021424967795610428,
      "pose_rmse_dtheta": 0.22057464718818665,
      "pose_rmse_dx": 0.05645471438765526,
      "pose_rmse_dy": 0.05513818562030792,
      "pose_rmse_mean": 0.11072252690792084,
      "rmse_dtheta": 0.027170946821570396,
      "rmse_dx": 0.006257239263504744,
      "rmse_dy": 0.004387031774967909,
      "rmse_mean": 0.012605072930455208,
      "rotation_flip": 0.004392971284687519,
      "sparse_tokens": 32201.0,
      "step": 2496,
      "turn_loss": 0.10329844057559967,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 40563.0,
      "epoch": 0.11601003530942204,
      "grad_norm": 0.6619809865951538,
      "learning_rate": 9.045084971874738e-06,
      "loss": 0.2055,
      "mae_dtheta": 0.042672447860240936,
      "mae_dx": 0.01285137515515089,
      "mae_dy": 0.004507721867412329,
      "pose_mae_dtheta": 0.3401094377040863,
      "pose_mae_dx": 0.1027861088514328,
      "pose_mae_dy": 0.05478784069418907,
      "pose_rmse_dtheta": 0.5673916935920715,
      "pose_rmse_dx": 0.215291827917099,
      "pose_rmse_dy": 0.1292698234319687,
      "pose_rmse_mean": 0.30398446321487427,
      "rmse_dtheta": 0.06124191731214523,
      "rmse_dx": 0.02478058636188507,
      "rmse_dy": 0.009193899109959602,
      "rmse_mean": 0.031738802790641785,
      "rotation_flip": 0.013360739685595036,
      "sparse_tokens": 30063.0,
      "step": 2497,
      "turn_loss": 0.32508230209350586,
      "turns": 125.0,
      "turns_per_sample": 125.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11605649507526482,
      "grad_norm": 0.5336825847625732,
      "learning_rate": 9.044307649541227e-06,
      "loss": 0.1436,
      "mae_dtheta": 0.008119555190205574,
      "mae_dx": 0.0011912924237549305,
      "mae_dy": 0.0011724887881428003,
      "pose_mae_dtheta": 0.05820924788713455,
      "pose_mae_dx": 0.01394742913544178,
      "pose_mae_dy": 0.017516354098916054,
      "pose_rmse_dtheta": 0.18555787205696106,
      "pose_rmse_dx": 0.03254201263189316,
      "pose_rmse_dy": 0.0451427698135376,
      "pose_rmse_mean": 0.08774755895137787,
      "rmse_dtheta": 0.023360397666692734,
      "rmse_dx": 0.003570381086319685,
      "rmse_dy": 0.002586070913821459,
      "rmse_mean": 0.009838949888944626,
      "rotation_flip": 0.0023288310039788485,
      "sparse_tokens": 32121.0,
      "step": 2498,
      "turn_loss": 0.04870487004518509,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1161029548411076,
      "grad_norm": 0.5538507699966431,
      "learning_rate": 9.04353004438711e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.011540079489350319,
      "mae_dx": 0.0028679606039077044,
      "mae_dy": 0.0033495526295155287,
      "pose_mae_dtheta": 0.08718669414520264,
      "pose_mae_dx": 0.03474336862564087,
      "pose_mae_dy": 0.03346755728125572,
      "pose_rmse_dtheta": 0.18784497678279877,
      "pose_rmse_dx": 0.09197963774204254,
      "pose_rmse_dy": 0.08234595507383347,
      "pose_rmse_mean": 0.12072353065013885,
      "rmse_dtheta": 0.025684654712677002,
      "rmse_dx": 0.00763022480532527,
      "rmse_dy": 0.00834739301353693,
      "rmse_mean": 0.013887424021959305,
      "rotation_flip": 0.003598560579121113,
      "sparse_tokens": 32153.0,
      "step": 2499,
      "turn_loss": 0.11673791706562042,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27904.0,
      "epoch": 0.11614941460695039,
      "grad_norm": 0.7490116357803345,
      "learning_rate": 9.042752156466765e-06,
      "loss": 0.1796,
      "mae_dtheta": 0.03584232181310654,
      "mae_dx": 0.014668161980807781,
      "mae_dy": 0.008356270380318165,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.749011218547821,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 154.1685333251953,
      "model/head/act_norm_mean": 103.90588662790698,
      "model/head/act_norm_min": 62.09187698364258,
      "model/head/act_over_embed": 71.40509807293472,
      "model/head/grad_frac": 0.08383411914110184,
      "model/head/grad_norm": 0.06279269605875015,
      "model/head/grad_zero_frac": 0.00019543941016308963,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6844681140988372,
      "model/head/update_ratio": 0.0010863661300390959,
      "model/head/weight_delta": 5.780583381652832,
      "model/head/weight_delta_rel": 0.10140855610370636,
      "model/head/weight_norm": 57.80067825317383,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4154948592185974,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41543934263032056,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4153710901737213,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2854938056599606,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12067683786153793,
      "model/modality_embedder.encoders.pose/grad_norm": 0.09038830548524857,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5101248204022989,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002935807453468442,
      "model/modality_embedder.encoders.pose/weight_delta": 1.8835670948028564,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06154200807213783,
      "model/modality_embedder.encoders.pose/weight_norm": 30.788227081298828,
      "model/modality_embedder/grad_frac": 0.12067683786153793,
      "model/modality_embedder/grad_norm": 0.09038830548524857,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5101248204022989,
      "model/modality_embedder/update_ratio": 0.002935807453468442,
      "model/modality_embedder/weight_delta": 1.8835670948028564,
      "model/modality_embedder/weight_delta_rel": 0.06154200807213783,
      "model/modality_embedder/weight_norm": 30.788227081298828,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.78362274169922,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.90752901208933,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.121498107910156,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.74226840077333,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05103118717670441,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03822293132543564,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013827228685840964,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.211497187614441,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.044147688895463943,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.643234252929688,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.63170623779297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.793734426910298,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.488856315612793,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.35127705862411,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.049713075160980225,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.037235651165246964,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012738429941236973,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.5169591903686523,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05254865065217018,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.230958938598633,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.10172271728516,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.494272563676635,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.008731842041016,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.519902786898808,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.04829265549778938,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03617174178361893,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011988600017502904,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.6218317747116089,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.054458074271678925,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.171781539916992,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.01724243164062,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.484611480251015,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.467586517333984,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.88768232421524,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.047923341393470764,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03589512035250664,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.00121515232603997,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.3835599422454834,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.047283511608839035,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.53960418701172,
      "model/normalizer/grad_frac": 0.17927250266075134,
      "model/normalizer/grad_norm": 0.1342771202325821,
      "model/normalizer/grad_zero_frac": 0.0002576189872343093,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001720354426652193,
      "model/normalizer/weight_delta": 2.9522452354431152,
      "model/normalizer/weight_delta_rel": 0.0380232110619545,
      "model/normalizer/weight_norm": 78.05200958251953,
      "pose_mae_dtheta": 0.26104044914245605,
      "pose_mae_dx": 0.13164934515953064,
      "pose_mae_dy": 0.08053914457559586,
      "pose_rmse_dtheta": 0.47060051560401917,
      "pose_rmse_dx": 0.2691003084182739,
      "pose_rmse_dy": 0.18631967902183533,
      "pose_rmse_mean": 0.3086735010147095,
      "rmse_dtheta": 0.05419762805104256,
      "rmse_dx": 0.027415085583925247,
      "rmse_dy": 0.017655644565820694,
      "rmse_mean": 0.03308945521712303,
      "rotation_flip": 0.018821604549884796,
      "sparse_tokens": 22840.0,
      "step": 2500,
      "turn_loss": 0.3364109992980957,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11619587437279316,
      "grad_norm": 0.584061861038208,
      "learning_rate": 9.041973985834595e-06,
      "loss": 0.11,
      "mae_dtheta": 0.005154021549969912,
      "mae_dx": 0.0010067482944577932,
      "mae_dy": 0.0004942482337355614,
      "pose_mae_dtheta": 0.03594555705785751,
      "pose_mae_dx": 0.007823444902896881,
      "pose_mae_dy": 0.00808428693562746,
      "pose_rmse_dtheta": 0.139295756816864,
      "pose_rmse_dx": 0.021594149991869926,
      "pose_rmse_dy": 0.02249985747039318,
      "pose_rmse_mean": 0.06112992390990257,
      "rmse_dtheta": 0.019117986783385277,
      "rmse_dx": 0.0032744864001870155,
      "rmse_dy": 0.0010697203688323498,
      "rmse_mean": 0.007820731960237026,
      "rotation_flip": 0.0015197568573057652,
      "sparse_tokens": 32089.0,
      "step": 2501,
      "turn_loss": 0.03369241952896118,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34713.0,
      "epoch": 0.11624233413863594,
      "grad_norm": 0.46293050050735474,
      "learning_rate": 9.041195532545013e-06,
      "loss": 0.138,
      "mae_dtheta": 0.024931276217103004,
      "mae_dx": 0.008778254501521587,
      "mae_dy": 0.0035955493804067373,
      "pose_mae_dtheta": 0.16894985735416412,
      "pose_mae_dx": 0.0628996416926384,
      "pose_mae_dy": 0.04152681306004524,
      "pose_rmse_dtheta": 0.3069452941417694,
      "pose_rmse_dx": 0.15501409769058228,
      "pose_rmse_dy": 0.09193477779626846,
      "pose_rmse_mean": 0.18463139235973358,
      "rmse_dtheta": 0.0412912592291832,
      "rmse_dx": 0.01981239952147007,
      "rmse_dy": 0.006798871327191591,
      "rmse_mean": 0.022634176537394524,
      "rotation_flip": 0.012337662279605865,
      "sparse_tokens": 27865.0,
      "step": 2502,
      "turn_loss": 0.19032105803489685,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.11628879390447872,
      "grad_norm": 0.6158958673477173,
      "learning_rate": 9.040416796652459e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.00768700847402215,
      "mae_dx": 0.0013391574611887336,
      "mae_dy": 0.0012017906410619617,
      "pose_mae_dtheta": 0.05168500542640686,
      "pose_mae_dx": 0.01394326239824295,
      "pose_mae_dy": 0.014245301485061646,
      "pose_rmse_dtheta": 0.18800434470176697,
      "pose_rmse_dx": 0.03601619601249695,
      "pose_rmse_dy": 0.03906666487455368,
      "pose_rmse_mean": 0.08769574016332626,
      "rmse_dtheta": 0.02289649099111557,
      "rmse_dx": 0.004440212622284889,
      "rmse_dy": 0.003146712202578783,
      "rmse_mean": 0.010161139070987701,
      "rotation_flip": 0.0065832785330712795,
      "sparse_tokens": 32073.0,
      "step": 2503,
      "turn_loss": 0.05359039828181267,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18127.0,
      "epoch": 0.1163352536703215,
      "grad_norm": 0.4604131579399109,
      "learning_rate": 9.03963777821139e-06,
      "loss": 0.1267,
      "mae_dtheta": 0.03400636464357376,
      "mae_dx": 0.0062526557594537735,
      "mae_dy": 0.004261502996087074,
      "pose_mae_dtheta": 0.2643875479698181,
      "pose_mae_dx": 0.05528704822063446,
      "pose_mae_dy": 0.05466780066490173,
      "pose_rmse_dtheta": 0.45834803581237793,
      "pose_rmse_dx": 0.12123114615678787,
      "pose_rmse_dy": 0.12648405134677887,
      "pose_rmse_mean": 0.23535440862178802,
      "rmse_dtheta": 0.05159357562661171,
      "rmse_dx": 0.015182973816990852,
      "rmse_dy": 0.008492304012179375,
      "rmse_mean": 0.025089619681239128,
      "rotation_flip": 0.01026957668364048,
      "sparse_tokens": 14103.0,
      "step": 2504,
      "turn_loss": 0.2797098755836487,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.11638171343616428,
      "grad_norm": 0.7115962505340576,
      "learning_rate": 9.038858477276282e-06,
      "loss": 0.1678,
      "mae_dtheta": 0.03573250770568848,
      "mae_dx": 0.018305687233805656,
      "mae_dy": 0.007885469123721123,
      "pose_mae_dtheta": 0.2952406704425812,
      "pose_mae_dx": 0.1685769408941269,
      "pose_mae_dy": 0.10624530911445618,
      "pose_rmse_dtheta": 0.4884462356567383,
      "pose_rmse_dx": 0.30358290672302246,
      "pose_rmse_dy": 0.19631391763687134,
      "pose_rmse_mean": 0.3294476866722107,
      "rmse_dtheta": 0.05158836022019386,
      "rmse_dx": 0.031647831201553345,
      "rmse_dy": 0.014241118915379047,
      "rmse_mean": 0.03249243646860123,
      "rotation_flip": 0.02369668334722519,
      "sparse_tokens": 7058.0,
      "step": 2505,
      "turn_loss": 0.39653947949409485,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.11642817320200706,
      "grad_norm": 0.5737468004226685,
      "learning_rate": 9.038078893901634e-06,
      "loss": 0.1442,
      "mae_dtheta": 0.0351564884185791,
      "mae_dx": 0.011699599213898182,
      "mae_dy": 0.005523189436644316,
      "pose_mae_dtheta": 0.2546146810054779,
      "pose_mae_dx": 0.09777522832155228,
      "pose_mae_dy": 0.06050630286335945,
      "pose_rmse_dtheta": 0.4630599319934845,
      "pose_rmse_dx": 0.23122942447662354,
      "pose_rmse_dy": 0.14793086051940918,
      "pose_rmse_mean": 0.28074008226394653,
      "rmse_dtheta": 0.05410851910710335,
      "rmse_dx": 0.023693040013313293,
      "rmse_dy": 0.011600478552281857,
      "rmse_mean": 0.02980067953467369,
      "rotation_flip": 0.011666666716337204,
      "sparse_tokens": 10251.0,
      "step": 2506,
      "turn_loss": 0.25611716508865356,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.11647463296784984,
      "grad_norm": 0.4500046372413635,
      "learning_rate": 9.037299028141961e-06,
      "loss": 0.1212,
      "mae_dtheta": 0.04144338518381119,
      "mae_dx": 0.01652485318481922,
      "mae_dy": 0.006159523967653513,
      "pose_mae_dtheta": 0.3471706807613373,
      "pose_mae_dx": 0.13244397938251495,
      "pose_mae_dy": 0.0677061527967453,
      "pose_rmse_dtheta": 0.5748896598815918,
      "pose_rmse_dx": 0.2424582540988922,
      "pose_rmse_dy": 0.16191309690475464,
      "pose_rmse_mean": 0.3264203369617462,
      "rmse_dtheta": 0.058515846729278564,
      "rmse_dx": 0.028349028900265694,
      "rmse_dy": 0.012797595001757145,
      "rmse_mean": 0.03322082385420799,
      "rotation_flip": 0.036474164575338364,
      "sparse_tokens": 5255.0,
      "step": 2507,
      "turn_loss": 0.35936158895492554,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11652109273369263,
      "grad_norm": 0.5465171933174133,
      "learning_rate": 9.0365188800518e-06,
      "loss": 0.1842,
      "mae_dtheta": 0.014099495485424995,
      "mae_dx": 0.003170967334881425,
      "mae_dy": 0.003064091084524989,
      "pose_mae_dtheta": 0.0966557115316391,
      "pose_mae_dx": 0.03435462340712547,
      "pose_mae_dy": 0.03467745706439018,
      "pose_rmse_dtheta": 0.22848385572433472,
      "pose_rmse_dx": 0.07692162692546844,
      "pose_rmse_dy": 0.07356138527393341,
      "pose_rmse_mean": 0.12632229924201965,
      "rmse_dtheta": 0.02838721126317978,
      "rmse_dx": 0.008428738452494144,
      "rmse_dy": 0.00616732332855463,
      "rmse_mean": 0.014327757060527802,
      "rotation_flip": 0.005087209399789572,
      "sparse_tokens": 32137.0,
      "step": 2508,
      "turn_loss": 0.12763068079948425,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1165675524995354,
      "grad_norm": 0.6088231205940247,
      "learning_rate": 9.035738449685707e-06,
      "loss": 0.1071,
      "mae_dtheta": 0.01109314989298582,
      "mae_dx": 0.0022435549180954695,
      "mae_dy": 0.002910431707277894,
      "pose_mae_dtheta": 0.07845620810985565,
      "pose_mae_dx": 0.02890094369649887,
      "pose_mae_dy": 0.03238356113433838,
      "pose_rmse_dtheta": 0.2143283635377884,
      "pose_rmse_dx": 0.087460458278656,
      "pose_rmse_dy": 0.08292870968580246,
      "pose_rmse_mean": 0.12823918461799622,
      "rmse_dtheta": 0.024082088842988014,
      "rmse_dx": 0.006433428265154362,
      "rmse_dy": 0.006724457256495953,
      "rmse_mean": 0.01241332571953535,
      "rotation_flip": 0.0049242423847317696,
      "sparse_tokens": 32105.0,
      "step": 2509,
      "turn_loss": 0.0883786678314209,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11661401226537818,
      "grad_norm": 0.5840306878089905,
      "learning_rate": 9.034957737098259e-06,
      "loss": 0.1787,
      "mae_dtheta": 0.013923673890531063,
      "mae_dx": 0.004292136523872614,
      "mae_dy": 0.004202407319098711,
      "pose_mae_dtheta": 0.10879192501306534,
      "pose_mae_dx": 0.037665143609046936,
      "pose_mae_dy": 0.03723953291773796,
      "pose_rmse_dtheta": 0.26008573174476624,
      "pose_rmse_dx": 0.08993048965930939,
      "pose_rmse_dy": 0.08892733603715897,
      "pose_rmse_mean": 0.14631453156471252,
      "rmse_dtheta": 0.030759058892726898,
      "rmse_dx": 0.012195976451039314,
      "rmse_dy": 0.010540562681853771,
      "rmse_mean": 0.017831865698099136,
      "rotation_flip": 0.0076161460019648075,
      "sparse_tokens": 32121.0,
      "step": 2510,
      "turn_loss": 0.16898997128009796,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.11666047203122096,
      "grad_norm": 0.7578156590461731,
      "learning_rate": 9.034176742344049e-06,
      "loss": 0.2939,
      "mae_dtheta": 0.039012033492326736,
      "mae_dx": 0.017728738486766815,
      "mae_dy": 0.009551757015287876,
      "pose_mae_dtheta": 0.29199013113975525,
      "pose_mae_dx": 0.14295125007629395,
      "pose_mae_dy": 0.11862272024154663,
      "pose_rmse_dtheta": 0.4474707841873169,
      "pose_rmse_dx": 0.2948683798313141,
      "pose_rmse_dy": 0.2178851217031479,
      "pose_rmse_mean": 0.32007476687431335,
      "rmse_dtheta": 0.05313953012228012,
      "rmse_dx": 0.03274395689368248,
      "rmse_dy": 0.015743980184197426,
      "rmse_mean": 0.03387582302093506,
      "rotation_flip": 0.021021021530032158,
      "sparse_tokens": 11505.0,
      "step": 2511,
      "turn_loss": 0.340188592672348,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 28139.0,
      "epoch": 0.11670693179706375,
      "grad_norm": 0.8856296539306641,
      "learning_rate": 9.033395465477697e-06,
      "loss": 0.3244,
      "mae_dtheta": 0.04337236285209656,
      "mae_dx": 0.013311070390045643,
      "mae_dy": 0.006774513050913811,
      "pose_mae_dtheta": 0.34308457374572754,
      "pose_mae_dx": 0.11271389573812485,
      "pose_mae_dy": 0.07079637050628662,
      "pose_rmse_dtheta": 0.563027560710907,
      "pose_rmse_dx": 0.2325645387172699,
      "pose_rmse_dy": 0.16844919323921204,
      "pose_rmse_mean": 0.32134708762168884,
      "rmse_dtheta": 0.061111822724342346,
      "rmse_dx": 0.025823919102549553,
      "rmse_dy": 0.013390198349952698,
      "rmse_mean": 0.03344198316335678,
      "rotation_flip": 0.01904761977493763,
      "sparse_tokens": 21123.0,
      "step": 2512,
      "turn_loss": 0.3591160774230957,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11675339156290652,
      "grad_norm": 0.5612809062004089,
      "learning_rate": 9.032613906553833e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.013367881067097187,
      "mae_dx": 0.003621775424107909,
      "mae_dy": 0.004400785081088543,
      "pose_mae_dtheta": 0.0968007817864418,
      "pose_mae_dx": 0.041139569133520126,
      "pose_mae_dy": 0.04662911966443062,
      "pose_rmse_dtheta": 0.19905412197113037,
      "pose_rmse_dx": 0.09267762303352356,
      "pose_rmse_dy": 0.09178926795721054,
      "pose_rmse_mean": 0.1278403401374817,
      "rmse_dtheta": 0.02566009759902954,
      "rmse_dx": 0.009784418158233166,
      "rmse_dy": 0.009261531755328178,
      "rmse_mean": 0.014902016147971153,
      "rotation_flip": 0.008990318514406681,
      "sparse_tokens": 32137.0,
      "step": 2513,
      "turn_loss": 0.12499925494194031,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1167998513287493,
      "grad_norm": 0.5614573359489441,
      "learning_rate": 9.031832065627115e-06,
      "loss": 0.0818,
      "mae_dtheta": 0.006931801326572895,
      "mae_dx": 0.0016799261793494225,
      "mae_dy": 0.0010388923110440373,
      "pose_mae_dtheta": 0.053593724966049194,
      "pose_mae_dx": 0.01695937104523182,
      "pose_mae_dy": 0.01586841605603695,
      "pose_rmse_dtheta": 0.2156929224729538,
      "pose_rmse_dx": 0.042399875819683075,
      "pose_rmse_dy": 0.0332089401781559,
      "pose_rmse_mean": 0.09710057824850082,
      "rmse_dtheta": 0.023944366723299026,
      "rmse_dx": 0.00487698195502162,
      "rmse_dy": 0.0020501825492829084,
      "rmse_mean": 0.010290510952472687,
      "rotation_flip": 0.0021082221064716578,
      "sparse_tokens": 32121.0,
      "step": 2514,
      "turn_loss": 0.04836874455213547,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.11684631109459208,
      "grad_norm": 0.7637990713119507,
      "learning_rate": 9.031049942752215e-06,
      "loss": 0.0918,
      "mae_dtheta": 0.008029762655496597,
      "mae_dx": 0.0023213266395032406,
      "mae_dy": 0.00119248335249722,
      "pose_mae_dtheta": 0.0532425194978714,
      "pose_mae_dx": 0.021305739879608154,
      "pose_mae_dy": 0.011945734731853008,
      "pose_rmse_dtheta": 0.15807494521141052,
      "pose_rmse_dx": 0.0621071420609951,
      "pose_rmse_dy": 0.034784700721502304,
      "pose_rmse_mean": 0.08498893678188324,
      "rmse_dtheta": 0.024904079735279083,
      "rmse_dx": 0.006398030556738377,
      "rmse_dy": 0.004095787648111582,
      "rmse_mean": 0.011799300089478493,
      "rotation_flip": 0.004067107103765011,
      "sparse_tokens": 32201.0,
      "step": 2515,
      "turn_loss": 0.08349113911390305,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.11689277086043487,
      "grad_norm": 0.5843121409416199,
      "learning_rate": 9.03026753798383e-06,
      "loss": 0.1523,
      "mae_dtheta": 0.009237593039870262,
      "mae_dx": 0.0023946366272866726,
      "mae_dy": 0.002213680185377598,
      "pose_mae_dtheta": 0.06678585708141327,
      "pose_mae_dx": 0.029958585277199745,
      "pose_mae_dy": 0.03470828756690025,
      "pose_rmse_dtheta": 0.15779978036880493,
      "pose_rmse_dx": 0.09213752299547195,
      "pose_rmse_dy": 0.0715814009308815,
      "pose_rmse_mean": 0.1071728989481926,
      "rmse_dtheta": 0.02102913148701191,
      "rmse_dx": 0.008663413114845753,
      "rmse_dy": 0.004593489691615105,
      "rmse_mean": 0.011428679339587688,
      "rotation_flip": 0.003027245169505477,
      "sparse_tokens": 32025.0,
      "step": 2516,
      "turn_loss": 0.09634551405906677,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.11693923062627765,
      "grad_norm": 1.2041089534759521,
      "learning_rate": 9.029484851376673e-06,
      "loss": 0.2679,
      "mae_dtheta": 0.012963621877133846,
      "mae_dx": 0.0103083411231637,
      "mae_dy": 0.00543172424659133,
      "pose_mae_dtheta": 0.10207449644804001,
      "pose_mae_dx": 0.055574849247932434,
      "pose_mae_dy": 0.06441263109445572,
      "pose_rmse_dtheta": 0.20959408581256866,
      "pose_rmse_dx": 0.10709064453840256,
      "pose_rmse_dy": 0.16432291269302368,
      "pose_rmse_mean": 0.16033588349819183,
      "rmse_dtheta": 0.024866409599781036,
      "rmse_dx": 0.02161371521651745,
      "rmse_dy": 0.010545438155531883,
      "rmse_mean": 0.019008522853255272,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 2510.0,
      "step": 2517,
      "turn_loss": 0.23354768753051758,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.11698569039212042,
      "grad_norm": 0.5464405417442322,
      "learning_rate": 9.028701882985477e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.0072995019145309925,
      "mae_dx": 0.0016504178056493402,
      "mae_dy": 0.0017926737200468779,
      "pose_mae_dtheta": 0.058621715754270554,
      "pose_mae_dx": 0.018251262605190277,
      "pose_mae_dy": 0.02998695895075798,
      "pose_rmse_dtheta": 0.13957162201404572,
      "pose_rmse_dx": 0.06104116141796112,
      "pose_rmse_dy": 0.06620030850172043,
      "pose_rmse_mean": 0.08893769979476929,
      "rmse_dtheta": 0.017865613102912903,
      "rmse_dx": 0.005923429504036903,
      "rmse_dy": 0.003842785721644759,
      "rmse_mean": 0.009210609830915928,
      "rotation_flip": 0.0037429819349199533,
      "sparse_tokens": 32057.0,
      "step": 2518,
      "turn_loss": 0.058744147419929504,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.1170321501579632,
      "grad_norm": 0.6366855502128601,
      "learning_rate": 9.027918632864998e-06,
      "loss": 0.0779,
      "mae_dtheta": 0.007372801657766104,
      "mae_dx": 0.0022700370755046606,
      "mae_dy": 0.0011291417758911848,
      "pose_mae_dtheta": 0.05205999314785004,
      "pose_mae_dx": 0.021110016852617264,
      "pose_mae_dy": 0.016246426850557327,
      "pose_rmse_dtheta": 0.13606837391853333,
      "pose_rmse_dx": 0.049683425575494766,
      "pose_rmse_dy": 0.03575834631919861,
      "pose_rmse_mean": 0.07383671402931213,
      "rmse_dtheta": 0.01852252334356308,
      "rmse_dx": 0.006350864190608263,
      "rmse_dy": 0.0021841709967702627,
      "rmse_mean": 0.009019186720252037,
      "rotation_flip": 0.0011355034075677395,
      "sparse_tokens": 32217.0,
      "step": 2519,
      "turn_loss": 0.06252066045999527,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.11707860992380599,
      "grad_norm": 1.0586103200912476,
      "learning_rate": 9.027135101070005e-06,
      "loss": 0.2879,
      "mae_dtheta": 0.022973328828811646,
      "mae_dx": 0.015740659087896347,
      "mae_dy": 0.007683463394641876,
      "pose_mae_dtheta": 0.16139426827430725,
      "pose_mae_dx": 0.11015422642230988,
      "pose_mae_dy": 0.06068681925535202,
      "pose_rmse_dtheta": 0.26683473587036133,
      "pose_rmse_dx": 0.274804949760437,
      "pose_rmse_dy": 0.1253242790699005,
      "pose_rmse_mean": 0.2223213165998459,
      "rmse_dtheta": 0.0395953506231308,
      "rmse_dx": 0.02975757047533989,
      "rmse_dy": 0.014114545658230782,
      "rmse_mean": 0.02782249078154564,
      "rotation_flip": 0.0062500000931322575,
      "sparse_tokens": 2553.0,
      "step": 2520,
      "turn_loss": 0.383344441652298,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.11712506968964877,
      "grad_norm": 0.5407359004020691,
      "learning_rate": 9.026351287655294e-06,
      "loss": 0.1356,
      "mae_dtheta": 0.02479127049446106,
      "mae_dx": 0.010478191077709198,
      "mae_dy": 0.006439763121306896,
      "pose_mae_dtheta": 0.1809561550617218,
      "pose_mae_dx": 0.07194918394088745,
      "pose_mae_dy": 0.05402446910738945,
      "pose_rmse_dtheta": 0.3554566204547882,
      "pose_rmse_dx": 0.17346404492855072,
      "pose_rmse_dy": 0.15386466681957245,
      "pose_rmse_mean": 0.22759512066841125,
      "rmse_dtheta": 0.04444895684719086,
      "rmse_dx": 0.022850416600704193,
      "rmse_dy": 0.017553092911839485,
      "rmse_mean": 0.02828415483236313,
      "rotation_flip": 0.013020833022892475,
      "sparse_tokens": 8388.0,
      "step": 2521,
      "turn_loss": 0.24954715371131897,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.11717152945549154,
      "grad_norm": 0.6149473786354065,
      "learning_rate": 9.025567192675676e-06,
      "loss": 0.1189,
      "mae_dtheta": 0.011138730682432652,
      "mae_dx": 0.003471286501735449,
      "mae_dy": 0.0027780544478446245,
      "pose_mae_dtheta": 0.07665770500898361,
      "pose_mae_dx": 0.027898160740733147,
      "pose_mae_dy": 0.02922842651605606,
      "pose_rmse_dtheta": 0.20653069019317627,
      "pose_rmse_dx": 0.08236505836248398,
      "pose_rmse_dy": 0.08079125732183456,
      "pose_rmse_mean": 0.1232290118932724,
      "rmse_dtheta": 0.027046797797083855,
      "rmse_dx": 0.010444187559187412,
      "rmse_dy": 0.008475126698613167,
      "rmse_mean": 0.015322037041187286,
      "rotation_flip": 0.0030097817070782185,
      "sparse_tokens": 32169.0,
      "step": 2522,
      "turn_loss": 0.09998048096895218,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.11721798922133432,
      "grad_norm": 0.48259708285331726,
      "learning_rate": 9.024782816185984e-06,
      "loss": 0.099,
      "mae_dtheta": 0.009959137067198753,
      "mae_dx": 0.0018173985881730914,
      "mae_dy": 0.0022013974376022816,
      "pose_mae_dtheta": 0.07135525345802307,
      "pose_mae_dx": 0.027729324996471405,
      "pose_mae_dy": 0.028415508568286896,
      "pose_rmse_dtheta": 0.18345937132835388,
      "pose_rmse_dx": 0.062091995030641556,
      "pose_rmse_dy": 0.06275411695241928,
      "pose_rmse_mean": 0.10276849567890167,
      "rmse_dtheta": 0.022612011060118675,
      "rmse_dx": 0.004527026787400246,
      "rmse_dy": 0.0046163927763700485,
      "rmse_mean": 0.01058514416217804,
      "rotation_flip": 0.0007259527919813991,
      "sparse_tokens": 32169.0,
      "step": 2523,
      "turn_loss": 0.08009213954210281,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.11726444898717711,
      "grad_norm": 0.6717329621315002,
      "learning_rate": 9.023998158241067e-06,
      "loss": 0.1702,
      "mae_dtheta": 0.0369880311191082,
      "mae_dx": 0.014454744756221771,
      "mae_dy": 0.006852822378277779,
      "pose_mae_dtheta": 0.2841342091560364,
      "pose_mae_dx": 0.11722560971975327,
      "pose_mae_dy": 0.07474785298109055,
      "pose_rmse_dtheta": 0.4631304442882538,
      "pose_rmse_dx": 0.2559354305267334,
      "pose_rmse_dy": 0.1592455804347992,
      "pose_rmse_mean": 0.29277050495147705,
      "rmse_dtheta": 0.054390668869018555,
      "rmse_dx": 0.0276957880705595,
      "rmse_dy": 0.013003422878682613,
      "rmse_mean": 0.0316966287791729,
      "rotation_flip": 0.01247771829366684,
      "sparse_tokens": 17191.0,
      "step": 2524,
      "turn_loss": 0.3385407328605652,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11731090875301989,
      "grad_norm": 0.4598659873008728,
      "learning_rate": 9.023213218895801e-06,
      "loss": 0.1178,
      "mae_dtheta": 0.008717754855751991,
      "mae_dx": 0.001606898382306099,
      "mae_dy": 0.0015819744439795613,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.459865927696228,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.7675018310547,
      "model/head/act_norm_mean": 121.14936474116162,
      "model/head/act_norm_min": 74.29090118408203,
      "model/head/act_over_embed": 83.25497766834887,
      "model/head/grad_frac": 0.10901715606451035,
      "model/head/grad_norm": 0.05013327673077583,
      "model/head/grad_zero_frac": 0.000186873076017946,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6851818970959596,
      "model/head/update_ratio": 0.000867236580234021,
      "model/head/weight_delta": 5.810902118682861,
      "model/head/weight_delta_rel": 0.10194043815135956,
      "model/head/weight_norm": 57.808074951171875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4153934419155121,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41532413970006193,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41525495052337646,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28541463712774,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10256552696228027,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04716639220714569,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5371179790748899,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015318617224693298,
      "model/modality_embedder.encoders.pose/weight_delta": 1.8943144083023071,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06189315766096115,
      "model/modality_embedder.encoders.pose/weight_norm": 30.790241241455078,
      "model/modality_embedder/grad_frac": 0.10256552696228027,
      "model/modality_embedder/grad_norm": 0.04716639220714569,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5371179790748899,
      "model/modality_embedder/update_ratio": 0.0015318617224693298,
      "model/modality_embedder/weight_delta": 1.8943144083023071,
      "model/modality_embedder/weight_delta_rel": 0.06189315766096115,
      "model/modality_embedder/weight_norm": 30.790241241455078,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.95093536376953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.534717211800544,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.98988151550293,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.860487365590817,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09750482439994812,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.044839147478342056,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016219493700191379,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.2222238779067993,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.044538576155900955,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.645219802856445,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.38108825683594,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.63940245711079,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.0011568069458,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.61963740839423,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09891444444656372,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.045487381517887115,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015559138264507055,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.5309889316558838,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05303465202450752,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.23515510559082,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.21294403076172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.60378587461921,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.264142036437988,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.96958008375332,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.1012415662407875,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04655754566192627,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001542898127809167,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.6367378234863281,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05495859310030937,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.175386428833008,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.00181579589844,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.369588744588743,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.400670051574707,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.183056347703314,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1132708489894867,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05208940431475639,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017632029484957457,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.396255612373352,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.047717392444610596,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.542490005493164,
      "model/normalizer/grad_frac": 0.4631207585334778,
      "model/normalizer/grad_norm": 0.2129734605550766,
      "model/normalizer/grad_zero_frac": 0.0001784424966899678,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002728478517383337,
      "model/normalizer/weight_delta": 2.9788973331451416,
      "model/normalizer/weight_delta_rel": 0.03836647421121597,
      "model/normalizer/weight_norm": 78.05575561523438,
      "pose_mae_dtheta": 0.06083708256483078,
      "pose_mae_dx": 0.020671041682362556,
      "pose_mae_dy": 0.020253600552678108,
      "pose_rmse_dtheta": 0.16055119037628174,
      "pose_rmse_dx": 0.04997368901968002,
      "pose_rmse_dy": 0.0550474151968956,
      "pose_rmse_mean": 0.08852410316467285,
      "rmse_dtheta": 0.021317264065146446,
      "rmse_dx": 0.004370855167508125,
      "rmse_dy": 0.003883298486471176,
      "rmse_mean": 0.00985713955014944,
      "rotation_flip": 0.0024461839348077774,
      "sparse_tokens": 32137.0,
      "step": 2525,
      "turn_loss": 0.06819041073322296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.11735736851886266,
      "grad_norm": 0.44545891880989075,
      "learning_rate": 9.022427998205076e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.034421246498823166,
      "mae_dx": 0.010871399194002151,
      "mae_dy": 0.009754928760230541,
      "pose_mae_dtheta": 0.24831221997737885,
      "pose_mae_dx": 0.11256063729524612,
      "pose_mae_dy": 0.1262684166431427,
      "pose_rmse_dtheta": 0.4331182539463043,
      "pose_rmse_dx": 0.21813549101352692,
      "pose_rmse_dy": 0.2230830192565918,
      "pose_rmse_mean": 0.29144561290740967,
      "rmse_dtheta": 0.04907369613647461,
      "rmse_dx": 0.0219733826816082,
      "rmse_dy": 0.01455643866211176,
      "rmse_mean": 0.028534507378935814,
      "rotation_flip": 0.013245033100247383,
      "sparse_tokens": 15227.0,
      "step": 2526,
      "turn_loss": 0.2810262143611908,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.11740382828470544,
      "grad_norm": 0.85164475440979,
      "learning_rate": 9.021642496223802e-06,
      "loss": 0.1693,
      "mae_dtheta": 0.036869440227746964,
      "mae_dx": 0.016478106379508972,
      "mae_dy": 0.005224866792559624,
      "pose_mae_dtheta": 0.2926403284072876,
      "pose_mae_dx": 0.12412363290786743,
      "pose_mae_dy": 0.06663023680448532,
      "pose_rmse_dtheta": 0.5070305466651917,
      "pose_rmse_dx": 0.268966406583786,
      "pose_rmse_dy": 0.16191531717777252,
      "pose_rmse_mean": 0.31263741850852966,
      "rmse_dtheta": 0.05406477674841881,
      "rmse_dx": 0.030270636081695557,
      "rmse_dy": 0.010480673983693123,
      "rmse_mean": 0.03160536289215088,
      "rotation_flip": 0.010175763629376888,
      "sparse_tokens": 18604.0,
      "step": 2527,
      "turn_loss": 0.2706505060195923,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.11745028805054822,
      "grad_norm": 0.8034523725509644,
      "learning_rate": 9.020856713006909e-06,
      "loss": 0.1653,
      "mae_dtheta": 0.032923560589551926,
      "mae_dx": 0.0064703780226409435,
      "mae_dy": 0.0049899183213710785,
      "pose_mae_dtheta": 0.23687075078487396,
      "pose_mae_dx": 0.05926911532878876,
      "pose_mae_dy": 0.07012885808944702,
      "pose_rmse_dtheta": 0.43640217185020447,
      "pose_rmse_dx": 0.1557486653327942,
      "pose_rmse_dy": 0.13257278501987457,
      "pose_rmse_mean": 0.24157452583312988,
      "rmse_dtheta": 0.05169933661818504,
      "rmse_dx": 0.01785253919661045,
      "rmse_dy": 0.007898620329797268,
      "rmse_mean": 0.02581683360040188,
      "rotation_flip": 0.009652509354054928,
      "sparse_tokens": 8720.0,
      "step": 2528,
      "turn_loss": 0.19179172813892365,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11749674781639101,
      "grad_norm": 0.47648003697395325,
      "learning_rate": 9.020070648609347e-06,
      "loss": 0.1224,
      "mae_dtheta": 0.00904121808707714,
      "mae_dx": 0.001677332678809762,
      "mae_dy": 0.0024998639710247517,
      "pose_mae_dtheta": 0.05580253154039383,
      "pose_mae_dx": 0.023746615275740623,
      "pose_mae_dy": 0.025149988010525703,
      "pose_rmse_dtheta": 0.11875634640455246,
      "pose_rmse_dx": 0.0609973706305027,
      "pose_rmse_dy": 0.05884974077343941,
      "pose_rmse_mean": 0.07953448593616486,
      "rmse_dtheta": 0.019422579556703568,
      "rmse_dx": 0.004174449946731329,
      "rmse_dy": 0.005677209235727787,
      "rmse_mean": 0.00975808035582304,
      "rotation_flip": 0.0015065913321450353,
      "sparse_tokens": 32121.0,
      "step": 2529,
      "turn_loss": 0.07586231082677841,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.11754320758223379,
      "grad_norm": 0.6096274852752686,
      "learning_rate": 9.019284303086086e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.025152461603283882,
      "mae_dx": 0.007548311725258827,
      "mae_dy": 0.005895073525607586,
      "pose_mae_dtheta": 0.17217880487442017,
      "pose_mae_dx": 0.06065238267183304,
      "pose_mae_dy": 0.0751403421163559,
      "pose_rmse_dtheta": 0.29325392842292786,
      "pose_rmse_dx": 0.13167868554592133,
      "pose_rmse_dy": 0.1808495670557022,
      "pose_rmse_mean": 0.20192739367485046,
      "rmse_dtheta": 0.038681089878082275,
      "rmse_dx": 0.01755143143236637,
      "rmse_dy": 0.011791352182626724,
      "rmse_mean": 0.022674625739455223,
      "rotation_flip": 0.02734375,
      "sparse_tokens": 5354.0,
      "step": 2530,
      "turn_loss": 0.22137120366096497,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11758966734807656,
      "grad_norm": 0.5715504288673401,
      "learning_rate": 9.01849767649212e-06,
      "loss": 0.1308,
      "mae_dtheta": 0.010529562830924988,
      "mae_dx": 0.0023630179930478334,
      "mae_dy": 0.0024298476055264473,
      "pose_mae_dtheta": 0.0684003233909607,
      "pose_mae_dx": 0.023634934797883034,
      "pose_mae_dy": 0.02654736302793026,
      "pose_rmse_dtheta": 0.1527654528617859,
      "pose_rmse_dx": 0.0607711486518383,
      "pose_rmse_dy": 0.059702664613723755,
      "pose_rmse_mean": 0.09107975661754608,
      "rmse_dtheta": 0.021926412358880043,
      "rmse_dx": 0.007433348800987005,
      "rmse_dy": 0.005710899364203215,
      "rmse_mean": 0.011690220795571804,
      "rotation_flip": 0.004574913997203112,
      "sparse_tokens": 32137.0,
      "step": 2531,
      "turn_loss": 0.10211353749036789,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.11763612711391934,
      "grad_norm": 0.5042498707771301,
      "learning_rate": 9.017710768882451e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.013895600102841854,
      "mae_dx": 0.00424147117882967,
      "mae_dy": 0.004252213053405285,
      "pose_mae_dtheta": 0.10031604766845703,
      "pose_mae_dx": 0.043489497154951096,
      "pose_mae_dy": 0.04868904873728752,
      "pose_rmse_dtheta": 0.21344861388206482,
      "pose_rmse_dx": 0.11156178265810013,
      "pose_rmse_dy": 0.11607100069522858,
      "pose_rmse_mean": 0.1470271348953247,
      "rmse_dtheta": 0.026822863146662712,
      "rmse_dx": 0.011976036243140697,
      "rmse_dy": 0.009645497426390648,
      "rmse_mean": 0.01614813320338726,
      "rotation_flip": 0.0025925925001502037,
      "sparse_tokens": 32073.0,
      "step": 2532,
      "turn_loss": 0.14152249693870544,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11768258687976213,
      "grad_norm": 0.7123416066169739,
      "learning_rate": 9.016923580312114e-06,
      "loss": 0.1554,
      "mae_dtheta": 0.014761759899556637,
      "mae_dx": 0.0046297963708639145,
      "mae_dy": 0.004365861415863037,
      "pose_mae_dtheta": 0.11403144150972366,
      "pose_mae_dx": 0.040426790714263916,
      "pose_mae_dy": 0.040600478649139404,
      "pose_rmse_dtheta": 0.30600982904434204,
      "pose_rmse_dx": 0.14164797961711884,
      "pose_rmse_dy": 0.13135837018489838,
      "pose_rmse_mean": 0.19300541281700134,
      "rmse_dtheta": 0.034312907606363297,
      "rmse_dx": 0.016009621322155,
      "rmse_dy": 0.013081721030175686,
      "rmse_mean": 0.021134749054908752,
      "rotation_flip": 0.004814636427909136,
      "sparse_tokens": 32121.0,
      "step": 2533,
      "turn_loss": 0.15408585965633392,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1177290466456049,
      "grad_norm": 0.5377202033996582,
      "learning_rate": 9.016136110836155e-06,
      "loss": 0.1484,
      "mae_dtheta": 0.011878469958901405,
      "mae_dx": 0.0020211192313581705,
      "mae_dy": 0.0022898328024894,
      "pose_mae_dtheta": 0.0826738253235817,
      "pose_mae_dx": 0.02294188365340233,
      "pose_mae_dy": 0.026223819702863693,
      "pose_rmse_dtheta": 0.21913506090641022,
      "pose_rmse_dx": 0.0495784729719162,
      "pose_rmse_dy": 0.06599138677120209,
      "pose_rmse_mean": 0.11156831681728363,
      "rmse_dtheta": 0.02776866778731346,
      "rmse_dx": 0.005646356847137213,
      "rmse_dy": 0.005896333605051041,
      "rmse_mean": 0.013103785924613476,
      "rotation_flip": 0.005691768601536751,
      "sparse_tokens": 32153.0,
      "step": 2534,
      "turn_loss": 0.08233276754617691,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27494.0,
      "epoch": 0.11777550641144768,
      "grad_norm": 1.4762378931045532,
      "learning_rate": 9.015348360509641e-06,
      "loss": 0.2827,
      "mae_dtheta": 0.0367916114628315,
      "mae_dx": 0.011720463633537292,
      "mae_dy": 0.004560616798698902,
      "pose_mae_dtheta": 0.3137522041797638,
      "pose_mae_dx": 0.09209959954023361,
      "pose_mae_dy": 0.057791296392679214,
      "pose_rmse_dtheta": 0.5666754841804504,
      "pose_rmse_dx": 0.20149408280849457,
      "pose_rmse_dy": 0.17097340524196625,
      "pose_rmse_mean": 0.3130476772785187,
      "rmse_dtheta": 0.05731445178389549,
      "rmse_dx": 0.023765288293361664,
      "rmse_dy": 0.012040048837661743,
      "rmse_mean": 0.031039929017424583,
      "rotation_flip": 0.006163328420370817,
      "sparse_tokens": 21615.0,
      "step": 2535,
      "turn_loss": 0.28520044684410095,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.11782196617729046,
      "grad_norm": 0.5131242871284485,
      "learning_rate": 9.014560329387661e-06,
      "loss": 0.1134,
      "mae_dtheta": 0.055663373321294785,
      "mae_dx": 0.013361765071749687,
      "mae_dy": 0.0045657348819077015,
      "pose_mae_dtheta": 0.5286935567855835,
      "pose_mae_dx": 0.134939044713974,
      "pose_mae_dy": 0.06019078567624092,
      "pose_rmse_dtheta": 0.7928507328033447,
      "pose_rmse_dx": 0.3145764172077179,
      "pose_rmse_dy": 0.1297534704208374,
      "pose_rmse_mean": 0.4123935401439667,
      "rmse_dtheta": 0.07433973997831345,
      "rmse_dx": 0.028212975710630417,
      "rmse_dy": 0.011085066944360733,
      "rmse_mean": 0.03787925839424133,
      "rotation_flip": 0.009771986864507198,
      "sparse_tokens": 5230.0,
      "step": 2536,
      "turn_loss": 0.30774345993995667,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11786842594313325,
      "grad_norm": 0.6109305024147034,
      "learning_rate": 9.013772017525324e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.009326150640845299,
      "mae_dx": 0.0020237716380506754,
      "mae_dy": 0.0021630162373185158,
      "pose_mae_dtheta": 0.06365878880023956,
      "pose_mae_dx": 0.024998223409056664,
      "pose_mae_dy": 0.025124887004494667,
      "pose_rmse_dtheta": 0.13958261907100677,
      "pose_rmse_dx": 0.06946711987257004,
      "pose_rmse_dy": 0.0496692918241024,
      "pose_rmse_mean": 0.08623968064785004,
      "rmse_dtheta": 0.01952234096825123,
      "rmse_dx": 0.006145763676613569,
      "rmse_dy": 0.004590504802763462,
      "rmse_mean": 0.010086203925311565,
      "rotation_flip": 0.003947368357330561,
      "sparse_tokens": 32105.0,
      "step": 2537,
      "turn_loss": 0.08454269170761108,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.11791488570897603,
      "grad_norm": 0.9484591484069824,
      "learning_rate": 9.012983424977753e-06,
      "loss": 0.2931,
      "mae_dtheta": 0.04508773982524872,
      "mae_dx": 0.013386192731559277,
      "mae_dy": 0.005370220169425011,
      "pose_mae_dtheta": 0.3982543647289276,
      "pose_mae_dx": 0.10331447422504425,
      "pose_mae_dy": 0.05094660073518753,
      "pose_rmse_dtheta": 0.6301745772361755,
      "pose_rmse_dx": 0.22203129529953003,
      "pose_rmse_dy": 0.11577513813972473,
      "pose_rmse_mean": 0.32266032695770264,
      "rmse_dtheta": 0.06304315477609634,
      "rmse_dx": 0.025107694789767265,
      "rmse_dy": 0.010908104479312897,
      "rmse_mean": 0.03301965445280075,
      "rotation_flip": 0.02120974101126194,
      "sparse_tokens": 22251.0,
      "step": 2538,
      "turn_loss": 0.3248837888240814,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.1179613454748188,
      "grad_norm": 0.7195706963539124,
      "learning_rate": 9.012194551800098e-06,
      "loss": 0.1748,
      "mae_dtheta": 0.03516164422035217,
      "mae_dx": 0.010735857300460339,
      "mae_dy": 0.00488167442381382,
      "pose_mae_dtheta": 0.2598624527454376,
      "pose_mae_dx": 0.09105955809354782,
      "pose_mae_dy": 0.05470747500658035,
      "pose_rmse_dtheta": 0.45482131838798523,
      "pose_rmse_dx": 0.215462327003479,
      "pose_rmse_dy": 0.14819391071796417,
      "pose_rmse_mean": 0.27282586693763733,
      "rmse_dtheta": 0.052281446754932404,
      "rmse_dx": 0.022638952359557152,
      "rmse_dy": 0.011591736227273941,
      "rmse_mean": 0.028837379068136215,
      "rotation_flip": 0.007901668548583984,
      "sparse_tokens": 20452.0,
      "step": 2539,
      "turn_loss": 0.2372957319021225,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.11800780524066158,
      "grad_norm": 0.546819806098938,
      "learning_rate": 9.011405398047526e-06,
      "loss": 0.184,
      "mae_dtheta": 0.04385210946202278,
      "mae_dx": 0.006307771895080805,
      "mae_dy": 0.01209905557334423,
      "pose_mae_dtheta": 0.3383239805698395,
      "pose_mae_dx": 0.060524407774209976,
      "pose_mae_dy": 0.13582560420036316,
      "pose_rmse_dtheta": 0.5426217317581177,
      "pose_rmse_dx": 0.12959825992584229,
      "pose_rmse_dy": 0.27996721863746643,
      "pose_rmse_mean": 0.31739574670791626,
      "rmse_dtheta": 0.059867411851882935,
      "rmse_dx": 0.01425207406282425,
      "rmse_dy": 0.023240113630890846,
      "rmse_mean": 0.032453201711177826,
      "rotation_flip": 0.013793103396892548,
      "sparse_tokens": 5043.0,
      "step": 2540,
      "turn_loss": 0.4024287462234497,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11805426500650437,
      "grad_norm": 0.540080726146698,
      "learning_rate": 9.01061596377522e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.01206339243799448,
      "mae_dx": 0.002203312935307622,
      "mae_dy": 0.0027443813160061836,
      "pose_mae_dtheta": 0.0807698518037796,
      "pose_mae_dx": 0.024363219738006592,
      "pose_mae_dy": 0.03351404890418053,
      "pose_rmse_dtheta": 0.15783493220806122,
      "pose_rmse_dx": 0.05724646523594856,
      "pose_rmse_dy": 0.0701429471373558,
      "pose_rmse_mean": 0.09507478773593903,
      "rmse_dtheta": 0.02250862866640091,
      "rmse_dx": 0.006365847308188677,
      "rmse_dy": 0.005405165255069733,
      "rmse_mean": 0.011426547542214394,
      "rotation_flip": 0.004961831960827112,
      "sparse_tokens": 32137.0,
      "step": 2541,
      "turn_loss": 0.10097775608301163,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11705.0,
      "epoch": 0.11810072477234715,
      "grad_norm": 0.7109006643295288,
      "learning_rate": 9.009826249038387e-06,
      "loss": 0.1559,
      "mae_dtheta": 0.031024320051074028,
      "mae_dx": 0.010352958925068378,
      "mae_dy": 0.004756440408527851,
      "pose_mae_dtheta": 0.22652830183506012,
      "pose_mae_dx": 0.08248449862003326,
      "pose_mae_dy": 0.05648311227560043,
      "pose_rmse_dtheta": 0.4366968870162964,
      "pose_rmse_dx": 0.19931922852993011,
      "pose_rmse_dy": 0.13157209753990173,
      "pose_rmse_mean": 0.2558627724647522,
      "rmse_dtheta": 0.04933391511440277,
      "rmse_dx": 0.02223634161055088,
      "rmse_dy": 0.00912200566381216,
      "rmse_mean": 0.02689742110669613,
      "rotation_flip": 0.011741682887077332,
      "sparse_tokens": 9351.0,
      "step": 2542,
      "turn_loss": 0.17839080095291138,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11814718453818993,
      "grad_norm": 0.606639564037323,
      "learning_rate": 9.009036253892252e-06,
      "loss": 0.149,
      "mae_dtheta": 0.013823728077113628,
      "mae_dx": 0.00344324903562665,
      "mae_dy": 0.004462309647351503,
      "pose_mae_dtheta": 0.09911530464887619,
      "pose_mae_dx": 0.04242396727204323,
      "pose_mae_dy": 0.04315141960978508,
      "pose_rmse_dtheta": 0.22966961562633514,
      "pose_rmse_dx": 0.10874912142753601,
      "pose_rmse_dy": 0.10295461863279343,
      "pose_rmse_mean": 0.14712445437908173,
      "rmse_dtheta": 0.028360581025481224,
      "rmse_dx": 0.008957738988101482,
      "rmse_dy": 0.009389343671500683,
      "rmse_mean": 0.01556922122836113,
      "rotation_flip": 0.006326889153569937,
      "sparse_tokens": 32137.0,
      "step": 2543,
      "turn_loss": 0.13195188343524933,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.1181936443040327,
      "grad_norm": 0.7129059433937073,
      "learning_rate": 9.008245978392061e-06,
      "loss": 0.1752,
      "mae_dtheta": 0.04048880189657211,
      "mae_dx": 0.017360925674438477,
      "mae_dy": 0.008258908055722713,
      "pose_mae_dtheta": 0.3004344403743744,
      "pose_mae_dx": 0.15822751820087433,
      "pose_mae_dy": 0.0933716744184494,
      "pose_rmse_dtheta": 0.5082613229751587,
      "pose_rmse_dx": 0.2919611930847168,
      "pose_rmse_dy": 0.20695984363555908,
      "pose_rmse_mean": 0.3357274532318115,
      "rmse_dtheta": 0.05836746096611023,
      "rmse_dx": 0.029868334531784058,
      "rmse_dy": 0.015985993668437004,
      "rmse_mean": 0.034740597009658813,
      "rotation_flip": 0.01707577332854271,
      "sparse_tokens": 15171.0,
      "step": 2544,
      "turn_loss": 0.3296107351779938,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 30170.0,
      "epoch": 0.11824010406987549,
      "grad_norm": 0.4718402922153473,
      "learning_rate": 9.007455422593077e-06,
      "loss": 0.1233,
      "mae_dtheta": 0.03305569663643837,
      "mae_dx": 0.009126707911491394,
      "mae_dy": 0.0032313663978129625,
      "pose_mae_dtheta": 0.26098528504371643,
      "pose_mae_dx": 0.07135577499866486,
      "pose_mae_dy": 0.03414960950613022,
      "pose_rmse_dtheta": 0.47069475054740906,
      "pose_rmse_dx": 0.16780464351177216,
      "pose_rmse_dy": 0.08253495395183563,
      "pose_rmse_mean": 0.2403447926044464,
      "rmse_dtheta": 0.05151572450995445,
      "rmse_dx": 0.019561031833291054,
      "rmse_dy": 0.006926736794412136,
      "rmse_mean": 0.02600116655230522,
      "rotation_flip": 0.017094017937779427,
      "sparse_tokens": 22239.0,
      "step": 2545,
      "turn_loss": 0.22343625128269196,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.11828656383571827,
      "grad_norm": 0.5430408120155334,
      "learning_rate": 9.006664586550585e-06,
      "loss": 0.1494,
      "mae_dtheta": 0.05070304125547409,
      "mae_dx": 0.00995348859578371,
      "mae_dy": 0.004585193935781717,
      "pose_mae_dtheta": 0.43019595742225647,
      "pose_mae_dx": 0.08626740425825119,
      "pose_mae_dy": 0.0431944876909256,
      "pose_rmse_dtheta": 0.702904999256134,
      "pose_rmse_dx": 0.18633314967155457,
      "pose_rmse_dy": 0.09717278182506561,
      "pose_rmse_mean": 0.3288036584854126,
      "rmse_dtheta": 0.07088275998830795,
      "rmse_dx": 0.020836222916841507,
      "rmse_dy": 0.008853677660226822,
      "rmse_mean": 0.033524222671985626,
      "rotation_flip": 0.021148037165403366,
      "sparse_tokens": 5767.0,
      "step": 2546,
      "turn_loss": 0.3409227728843689,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.11833302360156105,
      "grad_norm": 0.8216776251792908,
      "learning_rate": 9.005873470319886e-06,
      "loss": 0.189,
      "mae_dtheta": 0.011062929406762123,
      "mae_dx": 0.002647925168275833,
      "mae_dy": 0.0021756645292043686,
      "pose_mae_dtheta": 0.07485243678092957,
      "pose_mae_dx": 0.02997288666665554,
      "pose_mae_dy": 0.030928760766983032,
      "pose_rmse_dtheta": 0.15873615443706512,
      "pose_rmse_dx": 0.07074478268623352,
      "pose_rmse_dy": 0.077458456158638,
      "pose_rmse_mean": 0.10231313109397888,
      "rmse_dtheta": 0.022627755999565125,
      "rmse_dx": 0.007304848171770573,
      "rmse_dy": 0.004622475244104862,
      "rmse_mean": 0.011518359184265137,
      "rotation_flip": 0.002081887563690543,
      "sparse_tokens": 32185.0,
      "step": 2547,
      "turn_loss": 0.10069818049669266,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.11837948336740382,
      "grad_norm": 0.7627692222595215,
      "learning_rate": 9.005082073956307e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.025200555101037025,
      "mae_dx": 0.013414911925792694,
      "mae_dy": 0.0037874409463256598,
      "pose_mae_dtheta": 0.19872231781482697,
      "pose_mae_dx": 0.09308332949876785,
      "pose_mae_dy": 0.046110332012176514,
      "pose_rmse_dtheta": 0.365222692489624,
      "pose_rmse_dx": 0.22715424001216888,
      "pose_rmse_dy": 0.09788115322589874,
      "pose_rmse_mean": 0.23008602857589722,
      "rmse_dtheta": 0.0402132123708725,
      "rmse_dx": 0.02741190977394581,
      "rmse_dy": 0.00766418594866991,
      "rmse_mean": 0.025096436962485313,
      "rotation_flip": 0.01116071455180645,
      "sparse_tokens": 8797.0,
      "step": 2548,
      "turn_loss": 0.2006998360157013,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11842594313324661,
      "grad_norm": 0.8038497567176819,
      "learning_rate": 9.004290397515188e-06,
      "loss": 0.1404,
      "mae_dtheta": 0.009571895003318787,
      "mae_dx": 0.0021275398321449757,
      "mae_dy": 0.0015766260912641883,
      "pose_mae_dtheta": 0.07131627202033997,
      "pose_mae_dx": 0.022561386227607727,
      "pose_mae_dy": 0.020039020106196404,
      "pose_rmse_dtheta": 0.21586079895496368,
      "pose_rmse_dx": 0.07005807757377625,
      "pose_rmse_dy": 0.0564575158059597,
      "pose_rmse_mean": 0.11412547528743744,
      "rmse_dtheta": 0.024393143132328987,
      "rmse_dx": 0.00684922281652689,
      "rmse_dy": 0.003945752512663603,
      "rmse_mean": 0.011729373596608639,
      "rotation_flip": 0.004377736244350672,
      "sparse_tokens": 32089.0,
      "step": 2549,
      "turn_loss": 0.06453216075897217,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.11847240289908939,
      "grad_norm": 0.5184476971626282,
      "learning_rate": 9.003498441051893e-06,
      "loss": 0.1335,
      "mae_dtheta": 0.011447322554886341,
      "mae_dx": 0.004026558715850115,
      "mae_dy": 0.0022949441336095333,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5184475779533386,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.4219512939453,
      "model/head/act_norm_mean": 111.84974747474747,
      "model/head/act_norm_min": 69.29902648925781,
      "model/head/act_over_embed": 76.8641936184805,
      "model/head/grad_frac": 0.12278503179550171,
      "model/head/grad_norm": 0.06365760415792465,
      "model/head/grad_zero_frac": 0.00017196129192598164,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6867552477904041,
      "model/head/update_ratio": 0.0011010398156940937,
      "model/head/weight_delta": 5.844283103942871,
      "model/head/weight_delta_rel": 0.10252603888511658,
      "model/head/weight_norm": 57.81589889526367,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41545483469963074,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41539008128070415,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4153168499469757,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28545995279931213,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07649219036102295,
      "model/modality_embedder.encoders.pose/grad_norm": 0.039657190442085266,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.529313932860262,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012879186542704701,
      "model/modality_embedder.encoders.pose/weight_delta": 1.9076048135757446,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.062327396124601364,
      "model/modality_embedder.encoders.pose/weight_norm": 30.791688919067383,
      "model/modality_embedder/grad_frac": 0.07649219036102295,
      "model/modality_embedder/grad_norm": 0.039657190442085266,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.529313932860262,
      "model/modality_embedder/update_ratio": 0.0012879186542704701,
      "model/modality_embedder/weight_delta": 1.9076048135757446,
      "model/modality_embedder/weight_delta_rel": 0.062327396124601364,
      "model/modality_embedder/weight_norm": 30.791688919067383,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.78723907470703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.68247705226872,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.110386848449707,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.274819949162463,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11779575794935226,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06107092648744583,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0022089460399001837,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.2323904037475586,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.044909048825502396,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.6470890045166,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.20454406738281,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.76612604216771,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.4396390914917,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.019513680302737,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.12105312198400497,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06275969743728638,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002146488521248102,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.543197751045227,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05345757678151131,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.238309860229492,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.96582794189453,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.752282247073914,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.61241340637207,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.384418819001635,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.12359565496444702,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06407786905765533,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0021233116276562214,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.6502206325531006,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05541132017970085,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.178268432617188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.85792541503906,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.61763217492384,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.44365119934082,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.666304753101272,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12965156137943268,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06721753627061844,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022751502692699432,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.4080866575241089,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.04812172055244446,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.544218063354492,
      "model/normalizer/grad_frac": 0.51740962266922,
      "model/normalizer/grad_norm": 0.2682497799396515,
      "model/normalizer/grad_zero_frac": 0.00015835295198485255,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0034364904277026653,
      "model/normalizer/weight_delta": 3.003375291824341,
      "model/normalizer/weight_delta_rel": 0.03868173435330391,
      "model/normalizer/weight_norm": 78.0592269897461,
      "pose_mae_dtheta": 0.07275984436273575,
      "pose_mae_dx": 0.0391809344291687,
      "pose_mae_dy": 0.026926720514893532,
      "pose_rmse_dtheta": 0.16768796741962433,
      "pose_rmse_dx": 0.10040973871946335,
      "pose_rmse_dy": 0.06097640469670296,
      "pose_rmse_mean": 0.10969137400388718,
      "rmse_dtheta": 0.024950362741947174,
      "rmse_dx": 0.011406037025153637,
      "rmse_dy": 0.004799515474587679,
      "rmse_mean": 0.013718638569116592,
      "rotation_flip": 0.0025234317872673273,
      "sparse_tokens": 32153.0,
      "step": 2550,
      "turn_loss": 0.15756076574325562,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.11851886266493217,
      "grad_norm": 0.5889079570770264,
      "learning_rate": 9.002706204621802e-06,
      "loss": 0.1835,
      "mae_dtheta": 0.009261555969715118,
      "mae_dx": 0.002129804342985153,
      "mae_dy": 0.0029485358390957117,
      "pose_mae_dtheta": 0.0651477575302124,
      "pose_mae_dx": 0.024546552449464798,
      "pose_mae_dy": 0.033211831003427505,
      "pose_rmse_dtheta": 0.13386677205562592,
      "pose_rmse_dx": 0.06449954956769943,
      "pose_rmse_dy": 0.08103308081626892,
      "pose_rmse_mean": 0.09313313663005829,
      "rmse_dtheta": 0.01820686273276806,
      "rmse_dx": 0.006803971715271473,
      "rmse_dy": 0.006248770747333765,
      "rmse_mean": 0.010419869795441628,
      "rotation_flip": 0.004268529359251261,
      "sparse_tokens": 32057.0,
      "step": 2551,
      "turn_loss": 0.07847960293292999,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11856532243077494,
      "grad_norm": 0.80348801612854,
      "learning_rate": 9.00191368828032e-06,
      "loss": 0.1375,
      "mae_dtheta": 0.00995088554918766,
      "mae_dx": 0.0022866004146635532,
      "mae_dy": 0.002912509022280574,
      "pose_mae_dtheta": 0.07590017467737198,
      "pose_mae_dx": 0.029863864183425903,
      "pose_mae_dy": 0.03339356929063797,
      "pose_rmse_dtheta": 0.17822904884815216,
      "pose_rmse_dx": 0.09453583508729935,
      "pose_rmse_dy": 0.09163211286067963,
      "pose_rmse_mean": 0.12146566808223724,
      "rmse_dtheta": 0.02211165800690651,
      "rmse_dx": 0.006747604813426733,
      "rmse_dy": 0.007495520636439323,
      "rmse_mean": 0.012118261307477951,
      "rotation_flip": 0.003795866621658206,
      "sparse_tokens": 32105.0,
      "step": 2552,
      "turn_loss": 0.08081649243831635,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.11861178219661773,
      "grad_norm": 1.0020209550857544,
      "learning_rate": 9.001120892082864e-06,
      "loss": 0.15,
      "mae_dtheta": 0.04183522239327431,
      "mae_dx": 0.019040489569306374,
      "mae_dy": 0.005007477942854166,
      "pose_mae_dtheta": 0.35552144050598145,
      "pose_mae_dx": 0.13896127045154572,
      "pose_mae_dy": 0.04999430105090141,
      "pose_rmse_dtheta": 0.6149250864982605,
      "pose_rmse_dx": 0.27276483178138733,
      "pose_rmse_dy": 0.10700485855340958,
      "pose_rmse_mean": 0.3315649628639221,
      "rmse_dtheta": 0.06288854032754898,
      "rmse_dx": 0.03209922835230827,
      "rmse_dy": 0.009793992154300213,
      "rmse_mean": 0.03492725268006325,
      "rotation_flip": 0.0043290043249726295,
      "sparse_tokens": 4274.0,
      "step": 2553,
      "turn_loss": 0.41360247135162354,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.11865824196246051,
      "grad_norm": 0.6465824842453003,
      "learning_rate": 9.000327816084875e-06,
      "loss": 0.1263,
      "mae_dtheta": 0.033629950135946274,
      "mae_dx": 0.01787342131137848,
      "mae_dy": 0.007048003375530243,
      "pose_mae_dtheta": 0.2898334562778473,
      "pose_mae_dx": 0.1553754061460495,
      "pose_mae_dy": 0.09155353903770447,
      "pose_rmse_dtheta": 0.46971234679222107,
      "pose_rmse_dx": 0.2831752598285675,
      "pose_rmse_dy": 0.172697514295578,
      "pose_rmse_mean": 0.3085283935070038,
      "rmse_dtheta": 0.04613829031586647,
      "rmse_dx": 0.030064677819609642,
      "rmse_dy": 0.011596236377954483,
      "rmse_mean": 0.02926640212535858,
      "rotation_flip": 0.013953488320112228,
      "sparse_tokens": 3967.0,
      "step": 2554,
      "turn_loss": 0.28920355439186096,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.11870470172830329,
      "grad_norm": 0.5523067712783813,
      "learning_rate": 8.999534460341818e-06,
      "loss": 0.1104,
      "mae_dtheta": 0.008591235615313053,
      "mae_dx": 0.0019424862693995237,
      "mae_dy": 0.0014522518031299114,
      "pose_mae_dtheta": 0.06083311140537262,
      "pose_mae_dx": 0.017992381006479263,
      "pose_mae_dy": 0.02013062685728073,
      "pose_rmse_dtheta": 0.18259896337985992,
      "pose_rmse_dx": 0.04783410206437111,
      "pose_rmse_dy": 0.054239027202129364,
      "pose_rmse_mean": 0.09489069879055023,
      "rmse_dtheta": 0.022415874525904655,
      "rmse_dx": 0.006292718928307295,
      "rmse_dy": 0.0036454543005675077,
      "rmse_mean": 0.010784683749079704,
      "rotation_flip": 0.0025348542258143425,
      "sparse_tokens": 32153.0,
      "step": 2555,
      "turn_loss": 0.06340529769659042,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18509.0,
      "epoch": 0.11875116149414607,
      "grad_norm": 0.5886462926864624,
      "learning_rate": 8.998740824909169e-06,
      "loss": 0.1579,
      "mae_dtheta": 0.03371790423989296,
      "mae_dx": 0.009909280575811863,
      "mae_dy": 0.0031617276836186647,
      "pose_mae_dtheta": 0.2663497030735016,
      "pose_mae_dx": 0.08044014871120453,
      "pose_mae_dy": 0.03012634441256523,
      "pose_rmse_dtheta": 0.45544859766960144,
      "pose_rmse_dx": 0.1779508888721466,
      "pose_rmse_dy": 0.0716157928109169,
      "pose_rmse_mean": 0.23500511050224304,
      "rmse_dtheta": 0.05305245518684387,
      "rmse_dx": 0.020620062947273254,
      "rmse_dy": 0.006204469595104456,
      "rmse_mean": 0.02662566304206848,
      "rotation_flip": 0.009911893866956234,
      "sparse_tokens": 14803.0,
      "step": 2556,
      "turn_loss": 0.2361583113670349,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11879762125998886,
      "grad_norm": 0.7123847007751465,
      "learning_rate": 8.997946909842426e-06,
      "loss": 0.149,
      "mae_dtheta": 0.011443722061812878,
      "mae_dx": 0.0024627475067973137,
      "mae_dy": 0.0033121088054031134,
      "pose_mae_dtheta": 0.08094322681427002,
      "pose_mae_dx": 0.034978240728378296,
      "pose_mae_dy": 0.03712566941976547,
      "pose_rmse_dtheta": 0.15016210079193115,
      "pose_rmse_dx": 0.08016666024923325,
      "pose_rmse_dy": 0.07337582856416702,
      "pose_rmse_mean": 0.10123486816883087,
      "rmse_dtheta": 0.021016962826251984,
      "rmse_dx": 0.006227520294487476,
      "rmse_dy": 0.0067275045439600945,
      "rmse_mean": 0.011323995888233185,
      "rotation_flip": 0.004481213167309761,
      "sparse_tokens": 32121.0,
      "step": 2557,
      "turn_loss": 0.09416824579238892,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25556.0,
      "epoch": 0.11884408102583163,
      "grad_norm": 0.7516604065895081,
      "learning_rate": 8.99715271519711e-06,
      "loss": 0.0948,
      "mae_dtheta": 0.03536390885710716,
      "mae_dx": 0.014550738967955112,
      "mae_dy": 0.0060371337458491325,
      "pose_mae_dtheta": 0.2523682713508606,
      "pose_mae_dx": 0.10939187556505203,
      "pose_mae_dy": 0.0855475440621376,
      "pose_rmse_dtheta": 0.43324193358421326,
      "pose_rmse_dx": 0.23224541544914246,
      "pose_rmse_dy": 0.2024581879377365,
      "pose_rmse_mean": 0.28931519389152527,
      "rmse_dtheta": 0.05114813894033432,
      "rmse_dx": 0.02789289504289627,
      "rmse_dy": 0.011095774360001087,
      "rmse_mean": 0.030045604333281517,
      "rotation_flip": 0.010450161062180996,
      "sparse_tokens": 20340.0,
      "step": 2558,
      "turn_loss": 0.2913132309913635,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11889054079167441,
      "grad_norm": 0.532681405544281,
      "learning_rate": 8.99635824102876e-06,
      "loss": 0.1747,
      "mae_dtheta": 0.013849642127752304,
      "mae_dx": 0.0025613843463361263,
      "mae_dy": 0.003594287671148777,
      "pose_mae_dtheta": 0.09244100004434586,
      "pose_mae_dx": 0.02612033672630787,
      "pose_mae_dy": 0.04026498273015022,
      "pose_rmse_dtheta": 0.20610080659389496,
      "pose_rmse_dx": 0.06536182016134262,
      "pose_rmse_dy": 0.09617611020803452,
      "pose_rmse_mean": 0.1225462481379509,
      "rmse_dtheta": 0.02707534283399582,
      "rmse_dx": 0.007466233801096678,
      "rmse_dy": 0.008220172487199306,
      "rmse_mean": 0.014253917150199413,
      "rotation_flip": 0.011623932048678398,
      "sparse_tokens": 32137.0,
      "step": 2559,
      "turn_loss": 0.1335384100675583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.11893700055751719,
      "grad_norm": 0.5982688665390015,
      "learning_rate": 8.995563487392934e-06,
      "loss": 0.2048,
      "mae_dtheta": 0.030353128910064697,
      "mae_dx": 0.007535858545452356,
      "mae_dy": 0.006617565639317036,
      "pose_mae_dtheta": 0.23554418981075287,
      "pose_mae_dx": 0.06977685540914536,
      "pose_mae_dy": 0.0823923870921135,
      "pose_rmse_dtheta": 0.4023069441318512,
      "pose_rmse_dx": 0.1724681854248047,
      "pose_rmse_dy": 0.19667130708694458,
      "pose_rmse_mean": 0.257148802280426,
      "rmse_dtheta": 0.045154180377721786,
      "rmse_dx": 0.01738603226840496,
      "rmse_dy": 0.01374902669340372,
      "rmse_mean": 0.025429746136069298,
      "rotation_flip": 0.013774104416370392,
      "sparse_tokens": 18811.0,
      "step": 2560,
      "turn_loss": 0.29723700881004333,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11898346032335998,
      "grad_norm": 0.4391932785511017,
      "learning_rate": 8.994768454345207e-06,
      "loss": 0.0992,
      "mae_dtheta": 0.009861103259027004,
      "mae_dx": 0.0030861319974064827,
      "mae_dy": 0.0035514873452484608,
      "pose_mae_dtheta": 0.07321444153785706,
      "pose_mae_dx": 0.0335719920694828,
      "pose_mae_dy": 0.026654327288269997,
      "pose_rmse_dtheta": 0.1940150111913681,
      "pose_rmse_dx": 0.09869968891143799,
      "pose_rmse_dy": 0.06957393884658813,
      "pose_rmse_mean": 0.1207628846168518,
      "rmse_dtheta": 0.024610521271824837,
      "rmse_dx": 0.008272215723991394,
      "rmse_dy": 0.008941012434661388,
      "rmse_mean": 0.013941249810159206,
      "rotation_flip": 0.004277159925550222,
      "sparse_tokens": 32137.0,
      "step": 2561,
      "turn_loss": 0.11156211048364639,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.11902992008920275,
      "grad_norm": 0.6070380806922913,
      "learning_rate": 8.993973141941179e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.03151974081993103,
      "mae_dx": 0.010798568837344646,
      "mae_dy": 0.004089859314262867,
      "pose_mae_dtheta": 0.2627941071987152,
      "pose_mae_dx": 0.10082504898309708,
      "pose_mae_dy": 0.056767504662275314,
      "pose_rmse_dtheta": 0.5176393389701843,
      "pose_rmse_dx": 0.23393476009368896,
      "pose_rmse_dy": 0.14321695268154144,
      "pose_rmse_mean": 0.29826369881629944,
      "rmse_dtheta": 0.05166694521903992,
      "rmse_dx": 0.02353658527135849,
      "rmse_dy": 0.008512656204402447,
      "rmse_mean": 0.02790539525449276,
      "rotation_flip": 0.005793742835521698,
      "sparse_tokens": 16276.0,
      "step": 2562,
      "turn_loss": 0.2293064296245575,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.11907637985504553,
      "grad_norm": 0.4527031183242798,
      "learning_rate": 8.993177550236464e-06,
      "loss": 0.1218,
      "mae_dtheta": 0.008441032841801643,
      "mae_dx": 0.0017578062834218144,
      "mae_dy": 0.0015585848595947027,
      "pose_mae_dtheta": 0.05413687974214554,
      "pose_mae_dx": 0.019129350781440735,
      "pose_mae_dy": 0.017368962988257408,
      "pose_rmse_dtheta": 0.1927567571401596,
      "pose_rmse_dx": 0.06286536157131195,
      "pose_rmse_dy": 0.05226866528391838,
      "pose_rmse_mean": 0.10263025760650635,
      "rmse_dtheta": 0.024901460856199265,
      "rmse_dx": 0.0061607398092746735,
      "rmse_dy": 0.004551373887807131,
      "rmse_mean": 0.011871191672980785,
      "rotation_flip": 0.005158437881618738,
      "sparse_tokens": 32057.0,
      "step": 2563,
      "turn_loss": 0.05992288142442703,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.11912283962088831,
      "grad_norm": 0.5654944777488708,
      "learning_rate": 8.992381679286702e-06,
      "loss": 0.1224,
      "mae_dtheta": 0.013803686015307903,
      "mae_dx": 0.003849664004519582,
      "mae_dy": 0.003570042084902525,
      "pose_mae_dtheta": 0.10712806135416031,
      "pose_mae_dx": 0.03586104139685631,
      "pose_mae_dy": 0.03400653228163719,
      "pose_rmse_dtheta": 0.27113160490989685,
      "pose_rmse_dx": 0.09209983795881271,
      "pose_rmse_dy": 0.09459824115037918,
      "pose_rmse_mean": 0.1526098996400833,
      "rmse_dtheta": 0.030519206076860428,
      "rmse_dx": 0.010425682179629803,
      "rmse_dy": 0.009251757524907589,
      "rmse_mean": 0.016732215881347656,
      "rotation_flip": 0.0028889805544167757,
      "sparse_tokens": 32137.0,
      "step": 2564,
      "turn_loss": 0.1276381015777588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.11916929938673108,
      "grad_norm": 0.5060068964958191,
      "learning_rate": 8.991585529147545e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.009091762825846672,
      "mae_dx": 0.001819239347241819,
      "mae_dy": 0.0005904349964112043,
      "pose_mae_dtheta": 0.06821995973587036,
      "pose_mae_dx": 0.01422476302832365,
      "pose_mae_dy": 0.008074562065303326,
      "pose_rmse_dtheta": 0.2348058968782425,
      "pose_rmse_dx": 0.03472699597477913,
      "pose_rmse_dy": 0.030141308903694153,
      "pose_rmse_mean": 0.09989140927791595,
      "rmse_dtheta": 0.027265777811408043,
      "rmse_dx": 0.005329116713255644,
      "rmse_dy": 0.0017856355989351869,
      "rmse_mean": 0.011460176669061184,
      "rotation_flip": 0.0034462951589375734,
      "sparse_tokens": 32185.0,
      "step": 2565,
      "turn_loss": 0.06327179074287415,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.11921575915257387,
      "grad_norm": 0.7113956809043884,
      "learning_rate": 8.99078909987467e-06,
      "loss": 0.1782,
      "mae_dtheta": 0.028477441519498825,
      "mae_dx": 0.009100495837628841,
      "mae_dy": 0.003800847800448537,
      "pose_mae_dtheta": 0.23101173341274261,
      "pose_mae_dx": 0.0854293629527092,
      "pose_mae_dy": 0.050645820796489716,
      "pose_rmse_dtheta": 0.4228779077529907,
      "pose_rmse_dx": 0.1738152951002121,
      "pose_rmse_dy": 0.10141011327505112,
      "pose_rmse_mean": 0.2327011078596115,
      "rmse_dtheta": 0.04510742053389549,
      "rmse_dx": 0.020955296233296394,
      "rmse_dy": 0.006425539962947369,
      "rmse_mean": 0.02416275255382061,
      "rotation_flip": 0.01230769231915474,
      "sparse_tokens": 5541.0,
      "step": 2566,
      "turn_loss": 0.24927206337451935,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.11926221891841665,
      "grad_norm": 0.6174167394638062,
      "learning_rate": 8.98999239152377e-06,
      "loss": 0.1581,
      "mae_dtheta": 0.03401072323322296,
      "mae_dx": 0.010578176937997341,
      "mae_dy": 0.004616564139723778,
      "pose_mae_dtheta": 0.24591797590255737,
      "pose_mae_dx": 0.0779302641749382,
      "pose_mae_dy": 0.05321035161614418,
      "pose_rmse_dtheta": 0.4818485975265503,
      "pose_rmse_dx": 0.1789339929819107,
      "pose_rmse_dy": 0.12180911749601364,
      "pose_rmse_mean": 0.26086390018463135,
      "rmse_dtheta": 0.05456634610891342,
      "rmse_dx": 0.02214423194527626,
      "rmse_dy": 0.010031403973698616,
      "rmse_mean": 0.028913995251059532,
      "rotation_flip": 0.013172337785363197,
      "sparse_tokens": 15177.0,
      "step": 2567,
      "turn_loss": 0.2590230703353882,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.11930867868425943,
      "grad_norm": 0.354327529668808,
      "learning_rate": 8.989195404150561e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.006911810487508774,
      "mae_dx": 0.0014407471753656864,
      "mae_dy": 0.0008975131204351783,
      "pose_mae_dtheta": 0.049384698271751404,
      "pose_mae_dx": 0.013513240031898022,
      "pose_mae_dy": 0.010600111447274685,
      "pose_rmse_dtheta": 0.1659414917230606,
      "pose_rmse_dx": 0.033077508211135864,
      "pose_rmse_dy": 0.0288563035428524,
      "pose_rmse_mean": 0.07595843821763992,
      "rmse_dtheta": 0.02227780409157276,
      "rmse_dx": 0.004107714630663395,
      "rmse_dy": 0.0028060374315828085,
      "rmse_mean": 0.009730519726872444,
      "rotation_flip": 0.0030425963923335075,
      "sparse_tokens": 32153.0,
      "step": 2568,
      "turn_loss": 0.04331490397453308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.1193551384501022,
      "grad_norm": 1.1623913049697876,
      "learning_rate": 8.988398137810778e-06,
      "loss": 0.2744,
      "mae_dtheta": 0.02927185781300068,
      "mae_dx": 0.011023747734725475,
      "mae_dy": 0.005791706033051014,
      "pose_mae_dtheta": 0.190898135304451,
      "pose_mae_dx": 0.06786572188138962,
      "pose_mae_dy": 0.0776471197605133,
      "pose_rmse_dtheta": 0.3168496787548065,
      "pose_rmse_dx": 0.15078362822532654,
      "pose_rmse_dy": 0.1563275158405304,
      "pose_rmse_mean": 0.2079869508743286,
      "rmse_dtheta": 0.04344724118709564,
      "rmse_dx": 0.020483776926994324,
      "rmse_dy": 0.011122207157313824,
      "rmse_mean": 0.025017742067575455,
      "rotation_flip": 0.03249097615480423,
      "sparse_tokens": 4929.0,
      "step": 2569,
      "turn_loss": 0.2604201138019562,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.119401598215945,
      "grad_norm": 0.6053658723831177,
      "learning_rate": 8.98760059256017e-06,
      "loss": 0.212,
      "mae_dtheta": 0.041390448808670044,
      "mae_dx": 0.01345050148665905,
      "mae_dy": 0.005605472717434168,
      "pose_mae_dtheta": 0.35236549377441406,
      "pose_mae_dx": 0.09095945209264755,
      "pose_mae_dy": 0.033448122441768646,
      "pose_rmse_dtheta": 0.6108546257019043,
      "pose_rmse_dx": 0.19174867868423462,
      "pose_rmse_dy": 0.06797531992197037,
      "pose_rmse_mean": 0.2901929020881653,
      "rmse_dtheta": 0.06463419646024704,
      "rmse_dx": 0.025370603427290916,
      "rmse_dy": 0.013458083383738995,
      "rmse_mean": 0.03448762744665146,
      "rotation_flip": 0.009009009227156639,
      "sparse_tokens": 8802.0,
      "step": 2570,
      "turn_loss": 0.3889976441860199,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.11944805798178777,
      "grad_norm": 0.6111410856246948,
      "learning_rate": 8.986802768454514e-06,
      "loss": 0.1475,
      "mae_dtheta": 0.03566710278391838,
      "mae_dx": 0.01088491827249527,
      "mae_dy": 0.0015980496536940336,
      "pose_mae_dtheta": 0.25567397475242615,
      "pose_mae_dx": 0.08664007484912872,
      "pose_mae_dy": 0.017160555347800255,
      "pose_rmse_dtheta": 0.5300745964050293,
      "pose_rmse_dx": 0.24149484932422638,
      "pose_rmse_dy": 0.05421546846628189,
      "pose_rmse_mean": 0.27526164054870605,
      "rmse_dtheta": 0.059430524706840515,
      "rmse_dx": 0.024661920964717865,
      "rmse_dy": 0.004075639881193638,
      "rmse_mean": 0.029389362782239914,
      "rotation_flip": 0.015723271295428276,
      "sparse_tokens": 6491.0,
      "step": 2571,
      "turn_loss": 0.2215150147676468,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 26848.0,
      "epoch": 0.11949451774763055,
      "grad_norm": 1.3296855688095093,
      "learning_rate": 8.9860046655496e-06,
      "loss": 0.2721,
      "mae_dtheta": 0.031020505353808403,
      "mae_dx": 0.012526589445769787,
      "mae_dy": 0.004602482542395592,
      "pose_mae_dtheta": 0.25294211506843567,
      "pose_mae_dx": 0.10406496375799179,
      "pose_mae_dy": 0.07035711407661438,
      "pose_rmse_dtheta": 0.4801182746887207,
      "pose_rmse_dx": 0.24123965203762054,
      "pose_rmse_dy": 0.16069304943084717,
      "pose_rmse_mean": 0.2940170168876648,
      "rmse_dtheta": 0.04886189475655556,
      "rmse_dx": 0.02641800045967102,
      "rmse_dy": 0.008476130664348602,
      "rmse_mean": 0.027918674051761627,
      "rotation_flip": 0.010084033943712711,
      "sparse_tokens": 21938.0,
      "step": 2572,
      "turn_loss": 0.2664217948913574,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.11954097751347333,
      "grad_norm": 0.5048052072525024,
      "learning_rate": 8.98520628390124e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.01984770968556404,
      "mae_dx": 0.006542625837028027,
      "mae_dy": 0.0024650900159031153,
      "pose_mae_dtheta": 0.1563475877046585,
      "pose_mae_dx": 0.05474509671330452,
      "pose_mae_dy": 0.033092934638261795,
      "pose_rmse_dtheta": 0.3495838940143585,
      "pose_rmse_dx": 0.16477324068546295,
      "pose_rmse_dy": 0.11594107747077942,
      "pose_rmse_mean": 0.21009942889213562,
      "rmse_dtheta": 0.04010312259197235,
      "rmse_dx": 0.018208036199212074,
      "rmse_dy": 0.008047917857766151,
      "rmse_mean": 0.022119691595435143,
      "rotation_flip": 0.0066964286379516125,
      "sparse_tokens": 13236.0,
      "step": 2573,
      "turn_loss": 0.15006577968597412,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.11958743727931612,
      "grad_norm": 0.4334962069988251,
      "learning_rate": 8.984407623565267e-06,
      "loss": 0.0831,
      "mae_dtheta": 0.00888145249336958,
      "mae_dx": 0.0016627887962386012,
      "mae_dy": 0.0016796616837382317,
      "pose_mae_dtheta": 0.06158306449651718,
      "pose_mae_dx": 0.018082672730088234,
      "pose_mae_dy": 0.021385520696640015,
      "pose_rmse_dtheta": 0.17197450995445251,
      "pose_rmse_dx": 0.051709096878767014,
      "pose_rmse_dy": 0.04959632083773613,
      "pose_rmse_mean": 0.09109331667423248,
      "rmse_dtheta": 0.020975802093744278,
      "rmse_dx": 0.005484261550009251,
      "rmse_dy": 0.0036083650775253773,
      "rmse_mean": 0.010022809728980064,
      "rotation_flip": 0.003791069844737649,
      "sparse_tokens": 32121.0,
      "step": 2574,
      "turn_loss": 0.06212710961699486,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1196338970451589,
      "grad_norm": 0.4524708092212677,
      "learning_rate": 8.983608684597529e-06,
      "loss": 0.1222,
      "mae_dtheta": 0.012011014856398106,
      "mae_dx": 0.0023684094194322824,
      "mae_dy": 0.0026194527745246887,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.45247071981430054,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 154.78860473632812,
      "model/head/act_norm_mean": 115.08202138573232,
      "model/head/act_norm_min": 67.29927825927734,
      "model/head/act_over_embed": 79.08544251113442,
      "model/head/grad_frac": 0.1186872273683548,
      "model/head/grad_norm": 0.053702495992183685,
      "model/head/grad_zero_frac": 0.00015800134860910475,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6903705018939394,
      "model/head/update_ratio": 0.0009287347784265876,
      "model/head/weight_delta": 5.877059459686279,
      "model/head/weight_delta_rel": 0.10310102999210358,
      "model/head/weight_norm": 57.82328414916992,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41561004519462585,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4155358284578195,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4154617190361023,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28556011162393236,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09472493082284927,
      "model/modality_embedder.encoders.pose/grad_norm": 0.042860258370637894,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5317930213004485,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001391826430335641,
      "model/modality_embedder.encoders.pose/weight_delta": 1.9159413576126099,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.062599778175354,
      "model/modality_embedder.encoders.pose/weight_norm": 30.79425621032715,
      "model/modality_embedder/grad_frac": 0.09472493082284927,
      "model/modality_embedder/grad_norm": 0.042860258370637894,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5317930213004485,
      "model/modality_embedder/update_ratio": 0.001391826430335641,
      "model/modality_embedder/weight_delta": 1.9159413576126099,
      "model/modality_embedder/weight_delta_rel": 0.062599778175354,
      "model/modality_embedder/weight_norm": 30.79425621032715,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.63067626953125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.949655282988616,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.042611122131348,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.458427330675182,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08854252845048904,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04006290063261986,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014489734312519431,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.2420153617858887,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04525978863239288,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.64916229248047,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.86686706542969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.008790784832453,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.34553337097168,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.18627516332506,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08163626492023468,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03693801909685135,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 9.582795610185713e-05,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012632013531401753,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.5553706884384155,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.053879257291555405,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.241592407226562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.49795532226562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.971550825717493,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.30852222442627,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.535102239070277,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08725108206272125,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03947855904698372,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013079987838864326,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.6644359827041626,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.055888645350933075,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.18241310119629,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.3316650390625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.87166305916306,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.391793251037598,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.840877155025073,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10252046585083008,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.046387508511543274,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001569958869367838,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.418873906135559,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.04849037528038025,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.54695701599121,
      "model/normalizer/grad_frac": 0.43323850631713867,
      "model/normalizer/grad_norm": 0.1960277408361435,
      "model/normalizer/grad_zero_frac": 0.00012880949361715466,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0025111387949436903,
      "model/normalizer/weight_delta": 3.0277886390686035,
      "model/normalizer/weight_delta_rel": 0.03899616375565529,
      "model/normalizer/weight_norm": 78.06328582763672,
      "pose_mae_dtheta": 0.09182815253734589,
      "pose_mae_dx": 0.02492288313806057,
      "pose_mae_dy": 0.027072377502918243,
      "pose_rmse_dtheta": 0.24867895245552063,
      "pose_rmse_dx": 0.06897629797458649,
      "pose_rmse_dy": 0.05846293643116951,
      "pose_rmse_mean": 0.1253727376461029,
      "rmse_dtheta": 0.02864873595535755,
      "rmse_dx": 0.006661540828645229,
      "rmse_dy": 0.006446434650570154,
      "rmse_mean": 0.013918904587626457,
      "rotation_flip": 0.005768438335508108,
      "sparse_tokens": 32105.0,
      "step": 2575,
      "turn_loss": 0.09949947148561478,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.11968035681100167,
      "grad_norm": 0.44722020626068115,
      "learning_rate": 8.982809467053897e-06,
      "loss": 0.1133,
      "mae_dtheta": 0.007164760958403349,
      "mae_dx": 0.001514660893008113,
      "mae_dy": 0.0014698239974677563,
      "pose_mae_dtheta": 0.048135336488485336,
      "pose_mae_dx": 0.01777450554072857,
      "pose_mae_dy": 0.02126016467809677,
      "pose_rmse_dtheta": 0.11733347177505493,
      "pose_rmse_dx": 0.05155562236905098,
      "pose_rmse_dy": 0.05267542600631714,
      "pose_rmse_mean": 0.07385484129190445,
      "rmse_dtheta": 0.01705535501241684,
      "rmse_dx": 0.0052238632924854755,
      "rmse_dy": 0.0032315393909811974,
      "rmse_mean": 0.008503586053848267,
      "rotation_flip": 0.005491762422025204,
      "sparse_tokens": 32089.0,
      "step": 2576,
      "turn_loss": 0.059216924011707306,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1658.0,
      "epoch": 0.11972681657684445,
      "grad_norm": 0.4254922568798065,
      "learning_rate": 8.982009970990262e-06,
      "loss": 0.0926,
      "mae_dtheta": 0.024826141074299812,
      "mae_dx": 0.014181123115122318,
      "mae_dy": 0.007820759899914265,
      "pose_mae_dtheta": 0.22140701115131378,
      "pose_mae_dx": 0.0904875248670578,
      "pose_mae_dy": 0.13578985631465912,
      "pose_rmse_dtheta": 0.33282554149627686,
      "pose_rmse_dx": 0.14806562662124634,
      "pose_rmse_dy": 0.2347712516784668,
      "pose_rmse_mean": 0.23855414986610413,
      "rmse_dtheta": 0.03541180118918419,
      "rmse_dx": 0.02824675850570202,
      "rmse_dy": 0.01095698494464159,
      "rmse_mean": 0.02487184852361679,
      "rotation_flip": 0.017241379246115685,
      "sparse_tokens": 1525.0,
      "step": 2577,
      "turn_loss": 0.3071058690547943,
      "turns": 5.0,
      "turns_per_sample": 5.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.11977327634268724,
      "grad_norm": 0.5335376858711243,
      "learning_rate": 8.981210196462533e-06,
      "loss": 0.1667,
      "mae_dtheta": 0.03230606019496918,
      "mae_dx": 0.010585852898657322,
      "mae_dy": 0.0032063613180071115,
      "pose_mae_dtheta": 0.24417370557785034,
      "pose_mae_dx": 0.08771905303001404,
      "pose_mae_dy": 0.03293715417385101,
      "pose_rmse_dtheta": 0.46458861231803894,
      "pose_rmse_dx": 0.20574183762073517,
      "pose_rmse_dy": 0.0790003314614296,
      "pose_rmse_mean": 0.2497769445180893,
      "rmse_dtheta": 0.05255816504359245,
      "rmse_dx": 0.022509697824716568,
      "rmse_dy": 0.006751719396561384,
      "rmse_mean": 0.02727319300174713,
      "rotation_flip": 0.012771392241120338,
      "sparse_tokens": 13807.0,
      "step": 2578,
      "turn_loss": 0.2584156095981598,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.11981973610853001,
      "grad_norm": 0.6548590064048767,
      "learning_rate": 8.980410143526638e-06,
      "loss": 0.2059,
      "mae_dtheta": 0.03290043771266937,
      "mae_dx": 0.007492306176573038,
      "mae_dy": 0.004675009753555059,
      "pose_mae_dtheta": 0.24568721652030945,
      "pose_mae_dx": 0.06014690548181534,
      "pose_mae_dy": 0.06327931582927704,
      "pose_rmse_dtheta": 0.4257628619670868,
      "pose_rmse_dx": 0.13539788126945496,
      "pose_rmse_dy": 0.14307382702827454,
      "pose_rmse_mean": 0.2347448766231537,
      "rmse_dtheta": 0.05031703785061836,
      "rmse_dx": 0.019234415143728256,
      "rmse_dy": 0.009388632141053677,
      "rmse_mean": 0.026313362643122673,
      "rotation_flip": 0.011869436129927635,
      "sparse_tokens": 6282.0,
      "step": 2579,
      "turn_loss": 0.23722431063652039,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.11986619587437279,
      "grad_norm": 0.4307520091533661,
      "learning_rate": 8.979609812238524e-06,
      "loss": 0.0748,
      "mae_dtheta": 0.03356867656111717,
      "mae_dx": 0.008697882294654846,
      "mae_dy": 0.006050941068679094,
      "pose_mae_dtheta": 0.2456664741039276,
      "pose_mae_dx": 0.06946571171283722,
      "pose_mae_dy": 0.06408257782459259,
      "pose_rmse_dtheta": 0.4254087507724762,
      "pose_rmse_dx": 0.16201525926589966,
      "pose_rmse_dy": 0.12601998448371887,
      "pose_rmse_mean": 0.23781466484069824,
      "rmse_dtheta": 0.04915866255760193,
      "rmse_dx": 0.018328210338950157,
      "rmse_dy": 0.012059275060892105,
      "rmse_mean": 0.026515385136008263,
      "rotation_flip": 0.015597919933497906,
      "sparse_tokens": 9885.0,
      "step": 2580,
      "turn_loss": 0.28375208377838135,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.11991265564021557,
      "grad_norm": 0.7003907561302185,
      "learning_rate": 8.978809202654161e-06,
      "loss": 0.1385,
      "mae_dtheta": 0.01689254865050316,
      "mae_dx": 0.002929198555648327,
      "mae_dy": 0.0052674501203000546,
      "pose_mae_dtheta": 0.11578606814146042,
      "pose_mae_dx": 0.04180684685707092,
      "pose_mae_dy": 0.05325525254011154,
      "pose_rmse_dtheta": 0.27783113718032837,
      "pose_rmse_dx": 0.0886794701218605,
      "pose_rmse_dy": 0.10714675486087799,
      "pose_rmse_mean": 0.15788578987121582,
      "rmse_dtheta": 0.032292257994413376,
      "rmse_dx": 0.008749017491936684,
      "rmse_dy": 0.011654472909867764,
      "rmse_mean": 0.017565250396728516,
      "rotation_flip": 0.00671785045415163,
      "sparse_tokens": 32057.0,
      "step": 2581,
      "turn_loss": 0.1694212406873703,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.11995911540605836,
      "grad_norm": 0.397847443819046,
      "learning_rate": 8.978008314829536e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.013694563880562782,
      "mae_dx": 0.0017004137625917792,
      "mae_dy": 0.002288523130118847,
      "pose_mae_dtheta": 0.09506895393133163,
      "pose_mae_dx": 0.026014002040028572,
      "pose_mae_dy": 0.03208485618233681,
      "pose_rmse_dtheta": 0.21740467846393585,
      "pose_rmse_dx": 0.06270647794008255,
      "pose_rmse_dy": 0.07498020678758621,
      "pose_rmse_mean": 0.11836379021406174,
      "rmse_dtheta": 0.02736293524503708,
      "rmse_dx": 0.00502987252548337,
      "rmse_dy": 0.004467977210879326,
      "rmse_mean": 0.012286929413676262,
      "rotation_flip": 0.0030911900103092194,
      "sparse_tokens": 32105.0,
      "step": 2582,
      "turn_loss": 0.10010976344347,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4884.0,
      "epoch": 0.12000557517190114,
      "grad_norm": 0.8279078006744385,
      "learning_rate": 8.977207148820653e-06,
      "loss": 0.1665,
      "mae_dtheta": 0.04145807400345802,
      "mae_dx": 0.016395172104239464,
      "mae_dy": 0.004392724949866533,
      "pose_mae_dtheta": 0.30525922775268555,
      "pose_mae_dx": 0.1220678985118866,
      "pose_mae_dy": 0.06335444748401642,
      "pose_rmse_dtheta": 0.577459990978241,
      "pose_rmse_dx": 0.2664268910884857,
      "pose_rmse_dy": 0.15145066380500793,
      "pose_rmse_mean": 0.3317791819572449,
      "rmse_dtheta": 0.05918815732002258,
      "rmse_dx": 0.030542535707354546,
      "rmse_dy": 0.007189905736595392,
      "rmse_mean": 0.032306868582963943,
      "rotation_flip": 0.0,
      "sparse_tokens": 4225.0,
      "step": 2583,
      "turn_loss": 0.2836672365665436,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12005203493774391,
      "grad_norm": 0.37801799178123474,
      "learning_rate": 8.97640570468354e-06,
      "loss": 0.0973,
      "mae_dtheta": 0.008498413488268852,
      "mae_dx": 0.001464197994209826,
      "mae_dy": 0.0005126709002070129,
      "pose_mae_dtheta": 0.06300538033246994,
      "pose_mae_dx": 0.012254518456757069,
      "pose_mae_dy": 0.010051596909761429,
      "pose_rmse_dtheta": 0.23601272702217102,
      "pose_rmse_dx": 0.0347147211432457,
      "pose_rmse_dy": 0.03371921926736832,
      "pose_rmse_mean": 0.10148222744464874,
      "rmse_dtheta": 0.02922944724559784,
      "rmse_dx": 0.004645505454391241,
      "rmse_dy": 0.0012729744194075465,
      "rmse_mean": 0.011715974658727646,
      "rotation_flip": 0.002336448524147272,
      "sparse_tokens": 32121.0,
      "step": 2584,
      "turn_loss": 0.060901448130607605,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.12009849470358669,
      "grad_norm": 1.3273693323135376,
      "learning_rate": 8.97560398247424e-06,
      "loss": 0.1658,
      "mae_dtheta": 0.009542874991893768,
      "mae_dx": 0.0013201440451666713,
      "mae_dy": 0.0013614854542538524,
      "pose_mae_dtheta": 0.06067488715052605,
      "pose_mae_dx": 0.01660352200269699,
      "pose_mae_dy": 0.021110625937581062,
      "pose_rmse_dtheta": 0.163174107670784,
      "pose_rmse_dx": 0.05116942897439003,
      "pose_rmse_dy": 0.05333850532770157,
      "pose_rmse_mean": 0.0892273485660553,
      "rmse_dtheta": 0.022588666528463364,
      "rmse_dx": 0.005353789776563644,
      "rmse_dy": 0.002677466254681349,
      "rmse_mean": 0.010206641629338264,
      "rotation_flip": 0.00046882324386388063,
      "sparse_tokens": 32041.0,
      "step": 2585,
      "turn_loss": 0.06722183525562286,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6822.0,
      "epoch": 0.12014495446942948,
      "grad_norm": 0.5192807912826538,
      "learning_rate": 8.97480198224882e-06,
      "loss": 0.112,
      "mae_dtheta": 0.03861482813954353,
      "mae_dx": 0.011998135596513748,
      "mae_dy": 0.005127910058945417,
      "pose_mae_dtheta": 0.3556038737297058,
      "pose_mae_dx": 0.07460732012987137,
      "pose_mae_dy": 0.08713998645544052,
      "pose_rmse_dtheta": 0.5710664987564087,
      "pose_rmse_dx": 0.20479056239128113,
      "pose_rmse_dy": 0.19104869663715363,
      "pose_rmse_mean": 0.3223019242286682,
      "rmse_dtheta": 0.05704379081726074,
      "rmse_dx": 0.026538832113146782,
      "rmse_dy": 0.008805885910987854,
      "rmse_mean": 0.030796170234680176,
      "rotation_flip": 0.009523809887468815,
      "sparse_tokens": 5249.0,
      "step": 2586,
      "turn_loss": 0.2517993450164795,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12019141423527226,
      "grad_norm": 0.4026082158088684,
      "learning_rate": 8.973999704063365e-06,
      "loss": 0.0848,
      "mae_dtheta": 0.013564911670982838,
      "mae_dx": 0.002174600027501583,
      "mae_dy": 0.003337723668664694,
      "pose_mae_dtheta": 0.09460326284170151,
      "pose_mae_dx": 0.028484497219324112,
      "pose_mae_dy": 0.04233633726835251,
      "pose_rmse_dtheta": 0.20328593254089355,
      "pose_rmse_dx": 0.07452119886875153,
      "pose_rmse_dy": 0.08881064504384995,
      "pose_rmse_mean": 0.12220592796802521,
      "rmse_dtheta": 0.025674324482679367,
      "rmse_dx": 0.007311842404305935,
      "rmse_dy": 0.007885920815169811,
      "rmse_mean": 0.013624030165374279,
      "rotation_flip": 0.0039840638637542725,
      "sparse_tokens": 32073.0,
      "step": 2587,
      "turn_loss": 0.11534220725297928,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.12023787400111503,
      "grad_norm": 0.532721757888794,
      "learning_rate": 8.973197147973978e-06,
      "loss": 0.1899,
      "mae_dtheta": 0.011543997563421726,
      "mae_dx": 0.0015835718950256705,
      "mae_dy": 0.002163243480026722,
      "pose_mae_dtheta": 0.0772266685962677,
      "pose_mae_dx": 0.022055458277463913,
      "pose_mae_dy": 0.03174107149243355,
      "pose_rmse_dtheta": 0.19009269773960114,
      "pose_rmse_dx": 0.06122847646474838,
      "pose_rmse_dy": 0.06759344786405563,
      "pose_rmse_mean": 0.10630487650632858,
      "rmse_dtheta": 0.024909621104598045,
      "rmse_dx": 0.0061352066695690155,
      "rmse_dy": 0.004656970966607332,
      "rmse_mean": 0.011900600045919418,
      "rotation_flip": 0.005448449403047562,
      "sparse_tokens": 32041.0,
      "step": 2588,
      "turn_loss": 0.09486465901136398,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.12028433376695781,
      "grad_norm": 1.143829107284546,
      "learning_rate": 8.97239431403678e-06,
      "loss": 0.3037,
      "mae_dtheta": 0.03759853541851044,
      "mae_dx": 0.012677304446697235,
      "mae_dy": 0.0024563195183873177,
      "pose_mae_dtheta": 0.3288739025592804,
      "pose_mae_dx": 0.1039724126458168,
      "pose_mae_dy": 0.032684504985809326,
      "pose_rmse_dtheta": 0.5432969331741333,
      "pose_rmse_dx": 0.24482004344463348,
      "pose_rmse_dy": 0.08269019424915314,
      "pose_rmse_mean": 0.29026907682418823,
      "rmse_dtheta": 0.05464566498994827,
      "rmse_dx": 0.025914952158927917,
      "rmse_dy": 0.005444538313895464,
      "rmse_mean": 0.028668386861681938,
      "rotation_flip": 0.007547169923782349,
      "sparse_tokens": 14404.0,
      "step": 2589,
      "turn_loss": 0.23397524654865265,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1203307935328006,
      "grad_norm": 0.4339236617088318,
      "learning_rate": 8.971591202307918e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.010880807414650917,
      "mae_dx": 0.002529636025428772,
      "mae_dy": 0.002671291586011648,
      "pose_mae_dtheta": 0.0812840610742569,
      "pose_mae_dx": 0.02692452073097229,
      "pose_mae_dy": 0.030657747760415077,
      "pose_rmse_dtheta": 0.20292146503925323,
      "pose_rmse_dx": 0.07256113737821579,
      "pose_rmse_dy": 0.08262946456670761,
      "pose_rmse_mean": 0.11937069147825241,
      "rmse_dtheta": 0.02414349652826786,
      "rmse_dx": 0.007473922800272703,
      "rmse_dy": 0.0071952128782868385,
      "rmse_mean": 0.012937543913722038,
      "rotation_flip": 0.003869968932121992,
      "sparse_tokens": 32121.0,
      "step": 2590,
      "turn_loss": 0.10365492850542068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.12037725329864338,
      "grad_norm": 0.5606266856193542,
      "learning_rate": 8.970787812843552e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.03944732993841171,
      "mae_dx": 0.010387139394879341,
      "mae_dy": 0.009368419647216797,
      "pose_mae_dtheta": 0.2804276943206787,
      "pose_mae_dx": 0.049395736306905746,
      "pose_mae_dy": 0.10491639375686646,
      "pose_rmse_dtheta": 0.6018937826156616,
      "pose_rmse_dx": 0.08638805150985718,
      "pose_rmse_dy": 0.2181118279695511,
      "pose_rmse_mean": 0.3021312355995178,
      "rmse_dtheta": 0.06174706667661667,
      "rmse_dx": 0.02025970257818699,
      "rmse_dy": 0.017362141981720924,
      "rmse_mean": 0.03312297165393829,
      "rotation_flip": 0.02097902074456215,
      "sparse_tokens": 2417.0,
      "step": 2591,
      "turn_loss": 0.28031840920448303,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12042371306448615,
      "grad_norm": 0.4752616584300995,
      "learning_rate": 8.969984145699859e-06,
      "loss": 0.1357,
      "mae_dtheta": 0.011937553063035011,
      "mae_dx": 0.0025418216828256845,
      "mae_dy": 0.0029179626144468784,
      "pose_mae_dtheta": 0.08847565203905106,
      "pose_mae_dx": 0.026578642427921295,
      "pose_mae_dy": 0.03159415349364281,
      "pose_rmse_dtheta": 0.22099079191684723,
      "pose_rmse_dx": 0.0656508058309555,
      "pose_rmse_dy": 0.07278039306402206,
      "pose_rmse_mean": 0.11980733275413513,
      "rmse_dtheta": 0.027059853076934814,
      "rmse_dx": 0.007610078901052475,
      "rmse_dy": 0.007539913523942232,
      "rmse_mean": 0.014069948345422745,
      "rotation_flip": 0.01011378038674593,
      "sparse_tokens": 32105.0,
      "step": 2592,
      "turn_loss": 0.10666311532258987,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.12047017283032893,
      "grad_norm": 0.41420847177505493,
      "learning_rate": 8.969180200933048e-06,
      "loss": 0.1361,
      "mae_dtheta": 0.04292173311114311,
      "mae_dx": 0.009320179931819439,
      "mae_dy": 0.003539492841809988,
      "pose_mae_dtheta": 0.32638290524482727,
      "pose_mae_dx": 0.08222518861293793,
      "pose_mae_dy": 0.04375423491001129,
      "pose_rmse_dtheta": 0.5456007122993469,
      "pose_rmse_dx": 0.20674046874046326,
      "pose_rmse_dy": 0.10824350267648697,
      "pose_rmse_mean": 0.2868615686893463,
      "rmse_dtheta": 0.06036476418375969,
      "rmse_dx": 0.021068593487143517,
      "rmse_dy": 0.008043511770665646,
      "rmse_mean": 0.029825624078512192,
      "rotation_flip": 0.017214396968483925,
      "sparse_tokens": 19477.0,
      "step": 2593,
      "turn_loss": 0.33727362751960754,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.12051663259617172,
      "grad_norm": 0.9911977648735046,
      "learning_rate": 8.968375978599333e-06,
      "loss": 0.3023,
      "mae_dtheta": 0.033379074186086655,
      "mae_dx": 0.01282462291419506,
      "mae_dy": 0.0037683264818042517,
      "pose_mae_dtheta": 0.24400414526462555,
      "pose_mae_dx": 0.10752355307340622,
      "pose_mae_dy": 0.039285365492105484,
      "pose_rmse_dtheta": 0.43791210651397705,
      "pose_rmse_dx": 0.24791698157787323,
      "pose_rmse_dy": 0.1121709942817688,
      "pose_rmse_mean": 0.26600003242492676,
      "rmse_dtheta": 0.05161929130554199,
      "rmse_dx": 0.02608552947640419,
      "rmse_dy": 0.00803377851843834,
      "rmse_mean": 0.028579533100128174,
      "rotation_flip": 0.01197126880288124,
      "sparse_tokens": 21215.0,
      "step": 2594,
      "turn_loss": 0.2574254870414734,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 19419.0,
      "epoch": 0.1205630923620145,
      "grad_norm": 0.5907108783721924,
      "learning_rate": 8.967571478754957e-06,
      "loss": 0.1018,
      "mae_dtheta": 0.03709295392036438,
      "mae_dx": 0.012132089585065842,
      "mae_dy": 0.0060584284365177155,
      "pose_mae_dtheta": 0.29885122179985046,
      "pose_mae_dx": 0.09325674921274185,
      "pose_mae_dy": 0.08607646822929382,
      "pose_rmse_dtheta": 0.5379657745361328,
      "pose_rmse_dx": 0.221575066447258,
      "pose_rmse_dy": 0.18332183361053467,
      "pose_rmse_mean": 0.31428757309913635,
      "rmse_dtheta": 0.057090651243925095,
      "rmse_dx": 0.024791747331619263,
      "rmse_dy": 0.011137026362121105,
      "rmse_mean": 0.031006475910544395,
      "rotation_flip": 0.008860759437084198,
      "sparse_tokens": 16364.0,
      "step": 2595,
      "turn_loss": 0.3462603986263275,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.12060955212785728,
      "grad_norm": 0.5882688164710999,
      "learning_rate": 8.966766701456177e-06,
      "loss": 0.1341,
      "mae_dtheta": 0.01219917368143797,
      "mae_dx": 0.004320752806961536,
      "mae_dy": 0.0036438866518437862,
      "pose_mae_dtheta": 0.09316092729568481,
      "pose_mae_dx": 0.047356441617012024,
      "pose_mae_dy": 0.039330556988716125,
      "pose_rmse_dtheta": 0.22834238409996033,
      "pose_rmse_dx": 0.14514951407909393,
      "pose_rmse_dy": 0.10786890983581543,
      "pose_rmse_mean": 0.16045360267162323,
      "rmse_dtheta": 0.02513834834098816,
      "rmse_dx": 0.013102150522172451,
      "rmse_dy": 0.009816552512347698,
      "rmse_mean": 0.01601901836693287,
      "rotation_flip": 0.004777831025421619,
      "sparse_tokens": 32041.0,
      "step": 2596,
      "turn_loss": 0.13677392899990082,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.12065601189370005,
      "grad_norm": 0.9995893239974976,
      "learning_rate": 8.965961646759273e-06,
      "loss": 0.2699,
      "mae_dtheta": 0.04285913705825806,
      "mae_dx": 0.0125535624101758,
      "mae_dy": 0.002890691626816988,
      "pose_mae_dtheta": 0.34293392300605774,
      "pose_mae_dx": 0.08864536136388779,
      "pose_mae_dy": 0.03406241536140442,
      "pose_rmse_dtheta": 0.5970796942710876,
      "pose_rmse_dx": 0.19866757094860077,
      "pose_rmse_dy": 0.07709872722625732,
      "pose_rmse_mean": 0.29094868898391724,
      "rmse_dtheta": 0.06126036122441292,
      "rmse_dx": 0.02451280504465103,
      "rmse_dy": 0.006136883981525898,
      "rmse_mean": 0.030636686831712723,
      "rotation_flip": 0.00544959120452404,
      "sparse_tokens": 6088.0,
      "step": 2597,
      "turn_loss": 0.27783575654029846,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.12070247165954284,
      "grad_norm": 0.9232642650604248,
      "learning_rate": 8.965156314720543e-06,
      "loss": 0.2837,
      "mae_dtheta": 0.029999257996678352,
      "mae_dx": 0.010702324099838734,
      "mae_dy": 0.0034999819472432137,
      "pose_mae_dtheta": 0.25239065289497375,
      "pose_mae_dx": 0.08039305359125137,
      "pose_mae_dy": 0.04218995198607445,
      "pose_rmse_dtheta": 0.43511834740638733,
      "pose_rmse_dx": 0.18082816898822784,
      "pose_rmse_dy": 0.08036135137081146,
      "pose_rmse_mean": 0.232102632522583,
      "rmse_dtheta": 0.04584980383515358,
      "rmse_dx": 0.02104402519762516,
      "rmse_dy": 0.006560299079865217,
      "rmse_mean": 0.024484708905220032,
      "rotation_flip": 0.003355704713612795,
      "sparse_tokens": 5155.0,
      "step": 2598,
      "turn_loss": 0.20775127410888672,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.12074893142538562,
      "grad_norm": 0.5574390292167664,
      "learning_rate": 8.9643507053963e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.027576183900237083,
      "mae_dx": 0.013696013018488884,
      "mae_dy": 0.004842274356633425,
      "pose_mae_dtheta": 0.20267780125141144,
      "pose_mae_dx": 0.12124443799257278,
      "pose_mae_dy": 0.05534249544143677,
      "pose_rmse_dtheta": 0.3800382912158966,
      "pose_rmse_dx": 0.28389617800712585,
      "pose_rmse_dy": 0.1117812916636467,
      "pose_rmse_mean": 0.25857192277908325,
      "rmse_dtheta": 0.04552521929144859,
      "rmse_dx": 0.02862647734582424,
      "rmse_dy": 0.008520285598933697,
      "rmse_mean": 0.02755732648074627,
      "rotation_flip": 0.008695651777088642,
      "sparse_tokens": 9998.0,
      "step": 2599,
      "turn_loss": 0.21501849591732025,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1207953911912284,
      "grad_norm": 0.5830325484275818,
      "learning_rate": 8.963544818842888e-06,
      "loss": 0.1781,
      "mae_dtheta": 0.013349384069442749,
      "mae_dx": 0.005224039312452078,
      "mae_dy": 0.006087021436542273,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5830327272415161,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.79440307617188,
      "model/head/act_norm_mean": 100.99092487373737,
      "model/head/act_norm_min": 47.855377197265625,
      "model/head/act_over_embed": 69.40190906516746,
      "model/head/grad_frac": 0.12352215498685837,
      "model/head/grad_norm": 0.07201746106147766,
      "model/head/grad_zero_frac": 0.0001465795503463596,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6899019491792929,
      "model/head/update_ratio": 0.001245312043465674,
      "model/head/weight_delta": 5.912838935852051,
      "model/head/weight_delta_rel": 0.10372871160507202,
      "model/head/weight_norm": 57.83085632324219,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4154340624809265,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4153542751736111,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4152675271034241,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28543534650729574,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09040489047765732,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05270900949835777,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5501996527777778,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017116412054747343,
      "model/modality_embedder.encoders.pose/weight_delta": 1.9228428602218628,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0628252699971199,
      "model/modality_embedder.encoders.pose/weight_norm": 30.79442596435547,
      "model/modality_embedder/grad_frac": 0.09040489047765732,
      "model/modality_embedder/grad_norm": 0.05270900949835777,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5501996527777778,
      "model/modality_embedder/update_ratio": 0.0017116412054747343,
      "model/modality_embedder/weight_delta": 1.9228428602218628,
      "model/modality_embedder/weight_delta_rel": 0.0628252699971199,
      "model/modality_embedder/weight_norm": 30.79442596435547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.22136688232422,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.74881253006253,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.120059967041016,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.633196948397396,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10049767047166824,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05859342962503433,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0021190159022808075,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.2530382871627808,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04566147178411484,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.6512451171875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.67650604248047,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.780608666025334,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.239497184753418,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.34225691285865,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09564633667469025,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05576494336128235,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001906844787299633,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.567945957183838,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05431487411260605,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.24461555480957,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.55772399902344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.781866281866282,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.453518867492676,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.717539882533544,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09684257954359055,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05646239221096039,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00187048374209553,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.6787774562835693,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05637020245194435,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.185983657836914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.37813568115234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.827618947410613,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.317890167236328,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.123400266933817,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10333922505378723,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06025015190243721,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020388965494930744,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.4314932823181152,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.048921648412942886,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.550371170043945,
      "model/normalizer/grad_frac": 0.42036229372024536,
      "model/normalizer/grad_norm": 0.2450849711894989,
      "model/normalizer/grad_zero_frac": 0.00013826339272782207,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0031394115649163723,
      "model/normalizer/weight_delta": 3.0535988807678223,
      "model/normalizer/weight_delta_rel": 0.03932858631014824,
      "model/normalizer/weight_norm": 78.06716918945312,
      "pose_mae_dtheta": 0.09790270775556564,
      "pose_mae_dx": 0.05740071460604668,
      "pose_mae_dy": 0.039916858077049255,
      "pose_rmse_dtheta": 0.19549718499183655,
      "pose_rmse_dx": 0.1564168781042099,
      "pose_rmse_dy": 0.08105920255184174,
      "pose_rmse_mean": 0.1443244218826294,
      "rmse_dtheta": 0.024600885808467865,
      "rmse_dx": 0.011900353245437145,
      "rmse_dy": 0.012242386117577553,
      "rmse_mean": 0.01624787598848343,
      "rotation_flip": 0.005651713348925114,
      "sparse_tokens": 32121.0,
      "step": 2600,
      "turn_loss": 0.15197713673114777,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.1207953911912284,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3206077516078949,
      "eval_objectnav_nopose_mae_dtheta": 0.04200942814350128,
      "eval_objectnav_nopose_mae_dx": 0.014871475286781788,
      "eval_objectnav_nopose_mae_dy": 0.005322587676346302,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.34316521883010864,
      "eval_objectnav_nopose_pose_mae_dx": 0.12014881521463394,
      "eval_objectnav_nopose_pose_mae_dy": 0.06072476506233215,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.568321943283081,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2512074410915375,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14200517535209656,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3205115497112274,
      "eval_objectnav_nopose_rmse_dtheta": 0.059791404753923416,
      "eval_objectnav_nopose_rmse_dx": 0.027770211920142174,
      "eval_objectnav_nopose_rmse_dy": 0.010792997665703297,
      "eval_objectnav_nopose_rmse_mean": 0.03278487175703049,
      "eval_objectnav_nopose_rotation_flip": 0.013799503445625305,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3206077516078949,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 2600
    },
    {
      "epoch": 0.1207953911912284,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28973206877708435,
      "eval_objectnav_pose_mae_dtheta": 0.03772221505641937,
      "eval_objectnav_pose_mae_dx": 0.012218844145536423,
      "eval_objectnav_pose_mae_dy": 0.004903863649815321,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2908293306827545,
      "eval_objectnav_pose_pose_mae_dx": 0.09772004932165146,
      "eval_objectnav_pose_pose_mae_dy": 0.052011214196681976,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5037139058113098,
      "eval_objectnav_pose_pose_rmse_dx": 0.21910984814167023,
      "eval_objectnav_pose_pose_rmse_dy": 0.12077100574970245,
      "eval_objectnav_pose_pose_rmse_mean": 0.28119826316833496,
      "eval_objectnav_pose_rmse_dtheta": 0.05571906641125679,
      "eval_objectnav_pose_rmse_dx": 0.024708550423383713,
      "eval_objectnav_pose_rmse_dy": 0.01015170942991972,
      "eval_objectnav_pose_rmse_mean": 0.030193109065294266,
      "eval_objectnav_pose_rotation_flip": 0.013812977820634842,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28973206877708435,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 2600
    },
    {
      "epoch": 0.1207953911912284,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10523633658885956,
      "eval_pointnav_mae_dtheta": 0.012154626660048962,
      "eval_pointnav_mae_dx": 0.0030485610477626324,
      "eval_pointnav_mae_dy": 0.002743631601333618,
      "eval_pointnav_pose_mae_dtheta": 0.087579146027565,
      "eval_pointnav_pose_mae_dx": 0.033699218183755875,
      "eval_pointnav_pose_mae_dy": 0.03109133429825306,
      "eval_pointnav_pose_rmse_dtheta": 0.23628126084804535,
      "eval_pointnav_pose_rmse_dx": 0.09418608993291855,
      "eval_pointnav_pose_rmse_dy": 0.08791805803775787,
      "eval_pointnav_pose_rmse_mean": 0.13946180045604706,
      "eval_pointnav_rmse_dtheta": 0.02835523895919323,
      "eval_pointnav_rmse_dx": 0.008914518170058727,
      "eval_pointnav_rmse_dy": 0.00714817875996232,
      "eval_pointnav_rmse_mean": 0.01480597909539938,
      "eval_pointnav_rotation_flip": 0.005349103361368179,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10523633658885956,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 2600
    },
    {
      "epoch": 0.1207953911912284,
      "eval_loss": 0.23852538565794626,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3206077516078949,
      "eval_objectnav_nopose_mae_dtheta": 0.04200942814350128,
      "eval_objectnav_nopose_mae_dx": 0.014871475286781788,
      "eval_objectnav_nopose_mae_dy": 0.005322587676346302,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.34316521883010864,
      "eval_objectnav_nopose_pose_mae_dx": 0.12014881521463394,
      "eval_objectnav_nopose_pose_mae_dy": 0.06072476506233215,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.568321943283081,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2512074410915375,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14200517535209656,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3205115497112274,
      "eval_objectnav_nopose_rmse_dtheta": 0.059791404753923416,
      "eval_objectnav_nopose_rmse_dx": 0.027770211920142174,
      "eval_objectnav_nopose_rmse_dy": 0.010792997665703297,
      "eval_objectnav_nopose_rmse_mean": 0.03278487175703049,
      "eval_objectnav_nopose_rotation_flip": 0.013799503445625305,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3206077516078949,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28973206877708435,
      "eval_objectnav_pose_mae_dtheta": 0.03772221505641937,
      "eval_objectnav_pose_mae_dx": 0.012218844145536423,
      "eval_objectnav_pose_mae_dy": 0.004903863649815321,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2908293306827545,
      "eval_objectnav_pose_pose_mae_dx": 0.09772004932165146,
      "eval_objectnav_pose_pose_mae_dy": 0.052011214196681976,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5037139058113098,
      "eval_objectnav_pose_pose_rmse_dx": 0.21910984814167023,
      "eval_objectnav_pose_pose_rmse_dy": 0.12077100574970245,
      "eval_objectnav_pose_pose_rmse_mean": 0.28119826316833496,
      "eval_objectnav_pose_rmse_dtheta": 0.05571906641125679,
      "eval_objectnav_pose_rmse_dx": 0.024708550423383713,
      "eval_objectnav_pose_rmse_dy": 0.01015170942991972,
      "eval_objectnav_pose_rmse_mean": 0.030193109065294266,
      "eval_objectnav_pose_rotation_flip": 0.013812977820634842,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28973206877708435,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10523633658885956,
      "eval_pointnav_mae_dtheta": 0.012154626660048962,
      "eval_pointnav_mae_dx": 0.0030485610477626324,
      "eval_pointnav_mae_dy": 0.002743631601333618,
      "eval_pointnav_pose_mae_dtheta": 0.087579146027565,
      "eval_pointnav_pose_mae_dx": 0.033699218183755875,
      "eval_pointnav_pose_mae_dy": 0.03109133429825306,
      "eval_pointnav_pose_rmse_dtheta": 0.23628126084804535,
      "eval_pointnav_pose_rmse_dx": 0.09418608993291855,
      "eval_pointnav_pose_rmse_dy": 0.08791805803775787,
      "eval_pointnav_pose_rmse_mean": 0.13946180045604706,
      "eval_pointnav_rmse_dtheta": 0.02835523895919323,
      "eval_pointnav_rmse_dx": 0.008914518170058727,
      "eval_pointnav_rmse_dy": 0.00714817875996232,
      "eval_pointnav_rmse_mean": 0.01480597909539938,
      "eval_pointnav_rotation_flip": 0.005349103361368179,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10523633658885956,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 2600
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12084185095707117,
      "grad_norm": 0.42272233963012695,
      "learning_rate": 8.96273865511666e-06,
      "loss": 0.1143,
      "mae_dtheta": 0.009900437667965889,
      "mae_dx": 0.0015246933326125145,
      "mae_dy": 0.001695426763035357,
      "pose_mae_dtheta": 0.07019035518169403,
      "pose_mae_dx": 0.02002539113163948,
      "pose_mae_dy": 0.024340283125638962,
      "pose_rmse_dtheta": 0.1871860921382904,
      "pose_rmse_dx": 0.0655510202050209,
      "pose_rmse_dy": 0.07040706276893616,
      "pose_rmse_mean": 0.10771472752094269,
      "rmse_dtheta": 0.024949897080659866,
      "rmse_dx": 0.005606267601251602,
      "rmse_dy": 0.004112462513148785,
      "rmse_mean": 0.011556209996342659,
      "rotation_flip": 0.003565970342606306,
      "sparse_tokens": 32073.0,
      "step": 2601,
      "turn_loss": 0.06975137442350388,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12088831072291395,
      "grad_norm": 0.4231172800064087,
      "learning_rate": 8.96193221427399e-06,
      "loss": 0.1366,
      "mae_dtheta": 0.010339783504605293,
      "mae_dx": 0.0016795099945738912,
      "mae_dy": 0.002393085975199938,
      "pose_mae_dtheta": 0.0745074525475502,
      "pose_mae_dx": 0.020034465938806534,
      "pose_mae_dy": 0.022920027375221252,
      "pose_rmse_dtheta": 0.23687314987182617,
      "pose_rmse_dx": 0.058471597731113434,
      "pose_rmse_dy": 0.060375142842531204,
      "pose_rmse_mean": 0.11857330054044724,
      "rmse_dtheta": 0.0270013939589262,
      "rmse_dx": 0.004716823808848858,
      "rmse_dy": 0.006358054932206869,
      "rmse_mean": 0.01269209012389183,
      "rotation_flip": 0.004559963475912809,
      "sparse_tokens": 32089.0,
      "step": 2602,
      "turn_loss": 0.07784436643123627,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12093477048875674,
      "grad_norm": 0.47404277324676514,
      "learning_rate": 8.961125496371273e-06,
      "loss": 0.0981,
      "mae_dtheta": 0.011337061412632465,
      "mae_dx": 0.0026116790249943733,
      "mae_dy": 0.002604606794193387,
      "pose_mae_dtheta": 0.08150285482406616,
      "pose_mae_dx": 0.02462923526763916,
      "pose_mae_dy": 0.02636958286166191,
      "pose_rmse_dtheta": 0.23332634568214417,
      "pose_rmse_dx": 0.06869302690029144,
      "pose_rmse_dy": 0.06345020979642868,
      "pose_rmse_mean": 0.12182319164276123,
      "rmse_dtheta": 0.027375461533665657,
      "rmse_dx": 0.008343267254531384,
      "rmse_dy": 0.0068427384831011295,
      "rmse_mean": 0.014187156222760677,
      "rotation_flip": 0.003693444188684225,
      "sparse_tokens": 32121.0,
      "step": 2603,
      "turn_loss": 0.11091577261686325,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.12098123025459952,
      "grad_norm": 1.7778185606002808,
      "learning_rate": 8.960318501464923e-06,
      "loss": 0.3181,
      "mae_dtheta": 0.048923563212156296,
      "mae_dx": 0.008729872293770313,
      "mae_dy": 0.0007170105818659067,
      "pose_mae_dtheta": 0.4036184847354889,
      "pose_mae_dx": 0.08170668035745621,
      "pose_mae_dy": 0.008395248092710972,
      "pose_rmse_dtheta": 0.7126495242118835,
      "pose_rmse_dx": 0.17869558930397034,
      "pose_rmse_dy": 0.016820857301354408,
      "pose_rmse_mean": 0.3027220070362091,
      "rmse_dtheta": 0.07295552641153336,
      "rmse_dx": 0.01947137527167797,
      "rmse_dy": 0.0013888933463022113,
      "rmse_mean": 0.031271934509277344,
      "rotation_flip": 0.004201680887490511,
      "sparse_tokens": 4166.0,
      "step": 2604,
      "turn_loss": 0.21667718887329102,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 7792.0,
      "epoch": 0.1210276900204423,
      "grad_norm": 0.6469973921775818,
      "learning_rate": 8.959511229611377e-06,
      "loss": 0.1107,
      "mae_dtheta": 0.03375403955578804,
      "mae_dx": 0.014858825132250786,
      "mae_dy": 0.008596367202699184,
      "pose_mae_dtheta": 0.2799024283885956,
      "pose_mae_dx": 0.1095145121216774,
      "pose_mae_dy": 0.13888616859912872,
      "pose_rmse_dtheta": 0.4685514271259308,
      "pose_rmse_dx": 0.2166137844324112,
      "pose_rmse_dy": 0.23360489308834076,
      "pose_rmse_mean": 0.3062567114830017,
      "rmse_dtheta": 0.04745901748538017,
      "rmse_dx": 0.028758184984326363,
      "rmse_dy": 0.01255818922072649,
      "rmse_mean": 0.029591798782348633,
      "rotation_flip": 0.01994301937520504,
      "sparse_tokens": 6628.0,
      "step": 2605,
      "turn_loss": 0.23487092554569244,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 1986.0,
      "epoch": 0.12107414978628507,
      "grad_norm": 0.6000508666038513,
      "learning_rate": 8.958703680867083e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.020358579233288765,
      "mae_dx": 0.025774914771318436,
      "mae_dy": 0.011373456567525864,
      "pose_mae_dtheta": 0.14947423338890076,
      "pose_mae_dx": 0.2125317007303238,
      "pose_mae_dy": 0.19890017807483673,
      "pose_rmse_dtheta": 0.18569143116474152,
      "pose_rmse_dx": 0.35466599464416504,
      "pose_rmse_dy": 0.292871356010437,
      "pose_rmse_mean": 0.2777429223060608,
      "rmse_dtheta": 0.027174049988389015,
      "rmse_dx": 0.0410681888461113,
      "rmse_dy": 0.013967334292829037,
      "rmse_mean": 0.02740319073200226,
      "rotation_flip": 0.0,
      "sparse_tokens": 1712.0,
      "step": 2606,
      "turn_loss": 0.3026812970638275,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.12112060955212786,
      "grad_norm": 0.641216516494751,
      "learning_rate": 8.957895855288517e-06,
      "loss": 0.2035,
      "mae_dtheta": 0.03551901504397392,
      "mae_dx": 0.01171064656227827,
      "mae_dy": 0.005941690411418676,
      "pose_mae_dtheta": 0.2566382586956024,
      "pose_mae_dx": 0.08729004859924316,
      "pose_mae_dy": 0.06710547208786011,
      "pose_rmse_dtheta": 0.4395524263381958,
      "pose_rmse_dx": 0.18962462246418,
      "pose_rmse_dy": 0.16351762413978577,
      "pose_rmse_mean": 0.2642315626144409,
      "rmse_dtheta": 0.05208767205476761,
      "rmse_dx": 0.023947715759277344,
      "rmse_dy": 0.01176790613681078,
      "rmse_mean": 0.02926776558160782,
      "rotation_flip": 0.015825169160962105,
      "sparse_tokens": 23078.0,
      "step": 2607,
      "turn_loss": 0.24303217232227325,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12116706931797064,
      "grad_norm": 0.47433218359947205,
      "learning_rate": 8.95708775293217e-06,
      "loss": 0.1225,
      "mae_dtheta": 0.012098418548703194,
      "mae_dx": 0.0028144700918346643,
      "mae_dy": 0.0033561743330210447,
      "pose_mae_dtheta": 0.08214376866817474,
      "pose_mae_dx": 0.03842081129550934,
      "pose_mae_dy": 0.03586777299642563,
      "pose_rmse_dtheta": 0.20481127500534058,
      "pose_rmse_dx": 0.10206408053636551,
      "pose_rmse_dy": 0.07971867173910141,
      "pose_rmse_mean": 0.12886467576026917,
      "rmse_dtheta": 0.025774262845516205,
      "rmse_dx": 0.008221004158258438,
      "rmse_dy": 0.007834034040570259,
      "rmse_mean": 0.013943101279437542,
      "rotation_flip": 0.0034429992083460093,
      "sparse_tokens": 32089.0,
      "step": 2608,
      "turn_loss": 0.10849034041166306,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23297.0,
      "epoch": 0.12121352908381341,
      "grad_norm": 1.3540486097335815,
      "learning_rate": 8.956279373854553e-06,
      "loss": 0.296,
      "mae_dtheta": 0.039566636085510254,
      "mae_dx": 0.014841114170849323,
      "mae_dy": 0.00600456865504384,
      "pose_mae_dtheta": 0.3203529119491577,
      "pose_mae_dx": 0.11310423910617828,
      "pose_mae_dy": 0.07741264253854752,
      "pose_rmse_dtheta": 0.5300208926200867,
      "pose_rmse_dx": 0.2359558790922165,
      "pose_rmse_dy": 0.1703154593706131,
      "pose_rmse_mean": 0.312097430229187,
      "rmse_dtheta": 0.056894268840551376,
      "rmse_dx": 0.027466729283332825,
      "rmse_dy": 0.010541796684265137,
      "rmse_mean": 0.031634267419576645,
      "rotation_flip": 0.01672862470149994,
      "sparse_tokens": 19554.0,
      "step": 2609,
      "turn_loss": 0.27988749742507935,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.12125998884965619,
      "grad_norm": 0.42772722244262695,
      "learning_rate": 8.955470718112195e-06,
      "loss": 0.0978,
      "mae_dtheta": 0.01022803783416748,
      "mae_dx": 0.002101729391142726,
      "mae_dy": 0.0019970936700701714,
      "pose_mae_dtheta": 0.06593181192874908,
      "pose_mae_dx": 0.02355845458805561,
      "pose_mae_dy": 0.023853106424212456,
      "pose_rmse_dtheta": 0.1528852880001068,
      "pose_rmse_dx": 0.05441189557313919,
      "pose_rmse_dy": 0.05400049686431885,
      "pose_rmse_mean": 0.08709922432899475,
      "rmse_dtheta": 0.02173432521522045,
      "rmse_dx": 0.00589732127264142,
      "rmse_dy": 0.0043596490286290646,
      "rmse_mean": 0.010663765482604504,
      "rotation_flip": 0.0036976169794797897,
      "sparse_tokens": 32137.0,
      "step": 2610,
      "turn_loss": 0.07602264732122421,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.12130644861549898,
      "grad_norm": 0.46548211574554443,
      "learning_rate": 8.954661785761648e-06,
      "loss": 0.126,
      "mae_dtheta": 0.033059533685445786,
      "mae_dx": 0.01182345300912857,
      "mae_dy": 0.006900477223098278,
      "pose_mae_dtheta": 0.2573620080947876,
      "pose_mae_dx": 0.09815984964370728,
      "pose_mae_dy": 0.08156762272119522,
      "pose_rmse_dtheta": 0.43527063727378845,
      "pose_rmse_dx": 0.1947351098060608,
      "pose_rmse_dy": 0.19517889618873596,
      "pose_rmse_mean": 0.27506154775619507,
      "rmse_dtheta": 0.0493551604449749,
      "rmse_dx": 0.022455427795648575,
      "rmse_dy": 0.014239328913390636,
      "rmse_mean": 0.02868330478668213,
      "rotation_flip": 0.01650412566959858,
      "sparse_tokens": 21503.0,
      "step": 2611,
      "turn_loss": 0.3011998236179352,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.12135290838134176,
      "grad_norm": 0.8294897079467773,
      "learning_rate": 8.953852576859476e-06,
      "loss": 0.242,
      "mae_dtheta": 0.032818567007780075,
      "mae_dx": 0.01617288775742054,
      "mae_dy": 0.008173411712050438,
      "pose_mae_dtheta": 0.25664860010147095,
      "pose_mae_dx": 0.1253228783607483,
      "pose_mae_dy": 0.07909895479679108,
      "pose_rmse_dtheta": 0.4440414607524872,
      "pose_rmse_dx": 0.26677680015563965,
      "pose_rmse_dy": 0.17254488170146942,
      "pose_rmse_mean": 0.2944543957710266,
      "rmse_dtheta": 0.047952838242053986,
      "rmse_dx": 0.028868671506643295,
      "rmse_dy": 0.017252590507268906,
      "rmse_mean": 0.031358033418655396,
      "rotation_flip": 0.013533834367990494,
      "sparse_tokens": 11299.0,
      "step": 2612,
      "turn_loss": 0.33694982528686523,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12139936814718454,
      "grad_norm": 0.4201517701148987,
      "learning_rate": 8.953043091462275e-06,
      "loss": 0.0834,
      "mae_dtheta": 0.008551070466637611,
      "mae_dx": 0.0017129168845713139,
      "mae_dy": 0.002531025093048811,
      "pose_mae_dtheta": 0.06146476790308952,
      "pose_mae_dx": 0.020785193890333176,
      "pose_mae_dy": 0.02672240138053894,
      "pose_rmse_dtheta": 0.15013359487056732,
      "pose_rmse_dx": 0.05906815826892853,
      "pose_rmse_dy": 0.07045077532529831,
      "pose_rmse_mean": 0.09321751445531845,
      "rmse_dtheta": 0.020306507125496864,
      "rmse_dx": 0.004949735943228006,
      "rmse_dy": 0.006547121796756983,
      "rmse_mean": 0.010601121932268143,
      "rotation_flip": 0.006337709259241819,
      "sparse_tokens": 32089.0,
      "step": 2613,
      "turn_loss": 0.08001262694597244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12144582791302731,
      "grad_norm": 0.633664608001709,
      "learning_rate": 8.952233329626647e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.010555672459304333,
      "mae_dx": 0.0015810200711712241,
      "mae_dy": 0.00278230058029294,
      "pose_mae_dtheta": 0.07340443134307861,
      "pose_mae_dx": 0.02073647826910019,
      "pose_mae_dy": 0.035029713064432144,
      "pose_rmse_dtheta": 0.1625065803527832,
      "pose_rmse_dx": 0.05819327011704445,
      "pose_rmse_dy": 0.11180222034454346,
      "pose_rmse_mean": 0.1108340248465538,
      "rmse_dtheta": 0.021571043878793716,
      "rmse_dx": 0.004339777398854494,
      "rmse_dy": 0.007228238508105278,
      "rmse_mean": 0.011046352796256542,
      "rotation_flip": 0.006031363271176815,
      "sparse_tokens": 32105.0,
      "step": 2614,
      "turn_loss": 0.09026094526052475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1214922876788701,
      "grad_norm": 0.40534910559654236,
      "learning_rate": 8.951423291409222e-06,
      "loss": 0.1103,
      "mae_dtheta": 0.007320187985897064,
      "mae_dx": 0.0018643218791112304,
      "mae_dy": 0.002382197417318821,
      "pose_mae_dtheta": 0.05379866436123848,
      "pose_mae_dx": 0.024497993290424347,
      "pose_mae_dy": 0.02348233014345169,
      "pose_rmse_dtheta": 0.15615226328372955,
      "pose_rmse_dx": 0.0575450174510479,
      "pose_rmse_dy": 0.05553482845425606,
      "pose_rmse_mean": 0.08974404633045197,
      "rmse_dtheta": 0.017395811155438423,
      "rmse_dx": 0.004379067104309797,
      "rmse_dy": 0.005296250339597464,
      "rmse_mean": 0.009023710153996944,
      "rotation_flip": 0.0036630036775022745,
      "sparse_tokens": 32169.0,
      "step": 2615,
      "turn_loss": 0.06526579707860947,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.12153874744471288,
      "grad_norm": 0.6209286451339722,
      "learning_rate": 8.950612976866643e-06,
      "loss": 0.186,
      "mae_dtheta": 0.04087252914905548,
      "mae_dx": 0.007002022583037615,
      "mae_dy": 0.005460776388645172,
      "pose_mae_dtheta": 0.3309551477432251,
      "pose_mae_dx": 0.06223592162132263,
      "pose_mae_dy": 0.057624466717243195,
      "pose_rmse_dtheta": 0.6063922643661499,
      "pose_rmse_dx": 0.14246997237205505,
      "pose_rmse_dy": 0.12382350116968155,
      "pose_rmse_mean": 0.2908952832221985,
      "rmse_dtheta": 0.06269064545631409,
      "rmse_dx": 0.017096225172281265,
      "rmse_dy": 0.010786166414618492,
      "rmse_mean": 0.03019101172685623,
      "rotation_flip": 0.011574073694646358,
      "sparse_tokens": 13468.0,
      "step": 2616,
      "turn_loss": 0.3210150897502899,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12158520721055566,
      "grad_norm": 0.6566329002380371,
      "learning_rate": 8.949802386055582e-06,
      "loss": 0.1484,
      "mae_dtheta": 0.01385287195444107,
      "mae_dx": 0.0031080860644578934,
      "mae_dy": 0.003583980957046151,
      "pose_mae_dtheta": 0.10327372699975967,
      "pose_mae_dx": 0.038458358496427536,
      "pose_mae_dy": 0.038399990648031235,
      "pose_rmse_dtheta": 0.23105588555335999,
      "pose_rmse_dx": 0.10135255008935928,
      "pose_rmse_dy": 0.08500504493713379,
      "pose_rmse_mean": 0.13913783431053162,
      "rmse_dtheta": 0.026909416541457176,
      "rmse_dx": 0.008406084030866623,
      "rmse_dy": 0.0076663256622850895,
      "rmse_mean": 0.014327275566756725,
      "rotation_flip": 0.007317965384572744,
      "sparse_tokens": 32105.0,
      "step": 2617,
      "turn_loss": 0.10978454351425171,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.12163166697639843,
      "grad_norm": 0.7019250988960266,
      "learning_rate": 8.948991519032717e-06,
      "loss": 0.125,
      "mae_dtheta": 0.008667105808854103,
      "mae_dx": 0.0026025285478681326,
      "mae_dy": 0.0010148416040465236,
      "pose_mae_dtheta": 0.07138611376285553,
      "pose_mae_dx": 0.02078249119222164,
      "pose_mae_dy": 0.010284447111189365,
      "pose_rmse_dtheta": 0.24267776310443878,
      "pose_rmse_dx": 0.059520747512578964,
      "pose_rmse_dy": 0.026690121740102768,
      "pose_rmse_mean": 0.1096295416355133,
      "rmse_dtheta": 0.02771223522722721,
      "rmse_dx": 0.008233251981437206,
      "rmse_dy": 0.004543067887425423,
      "rmse_mean": 0.013496185652911663,
      "rotation_flip": 0.0051428573206067085,
      "sparse_tokens": 32185.0,
      "step": 2618,
      "turn_loss": 0.07456155866384506,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.12167812674224122,
      "grad_norm": 0.5635544657707214,
      "learning_rate": 8.948180375854759e-06,
      "loss": 0.1833,
      "mae_dtheta": 0.06131873279809952,
      "mae_dx": 0.012632695026695728,
      "mae_dy": 0.004942283965647221,
      "pose_mae_dtheta": 0.56303471326828,
      "pose_mae_dx": 0.10741561651229858,
      "pose_mae_dy": 0.032491039484739304,
      "pose_rmse_dtheta": 0.7786620855331421,
      "pose_rmse_dx": 0.22106292843818665,
      "pose_rmse_dy": 0.07101574540138245,
      "pose_rmse_mean": 0.35691356658935547,
      "rmse_dtheta": 0.07892632484436035,
      "rmse_dx": 0.024874262511730194,
      "rmse_dy": 0.010966270230710506,
      "rmse_mean": 0.03825562074780464,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 2018.0,
      "step": 2619,
      "turn_loss": 0.3621191680431366,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.121724586508084,
      "grad_norm": 0.4763253331184387,
      "learning_rate": 8.947368956578423e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.012527850456535816,
      "mae_dx": 0.0028551407158374786,
      "mae_dy": 0.0033552218228578568,
      "pose_mae_dtheta": 0.08613970875740051,
      "pose_mae_dx": 0.02839050441980362,
      "pose_mae_dy": 0.036000534892082214,
      "pose_rmse_dtheta": 0.17315392196178436,
      "pose_rmse_dx": 0.07165667414665222,
      "pose_rmse_dy": 0.07418233156204224,
      "pose_rmse_mean": 0.1063309758901596,
      "rmse_dtheta": 0.023731539025902748,
      "rmse_dx": 0.007886101491749287,
      "rmse_dy": 0.006264055613428354,
      "rmse_mean": 0.012627232819795609,
      "rotation_flip": 0.003759398590773344,
      "sparse_tokens": 32121.0,
      "step": 2620,
      "turn_loss": 0.1161498948931694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.12177104627392678,
      "grad_norm": 0.4640205502510071,
      "learning_rate": 8.94655726126046e-06,
      "loss": 0.1753,
      "mae_dtheta": 0.042940206825733185,
      "mae_dx": 0.013220623135566711,
      "mae_dy": 0.0044348412193357944,
      "pose_mae_dtheta": 0.39572873711586,
      "pose_mae_dx": 0.09969810396432877,
      "pose_mae_dy": 0.06351155042648315,
      "pose_rmse_dtheta": 0.6350157260894775,
      "pose_rmse_dx": 0.18769322335720062,
      "pose_rmse_dy": 0.1722118854522705,
      "pose_rmse_mean": 0.3316403031349182,
      "rmse_dtheta": 0.0604756735265255,
      "rmse_dx": 0.023972148075699806,
      "rmse_dy": 0.010112924501299858,
      "rmse_mean": 0.03152025118470192,
      "rotation_flip": 0.016597511246800423,
      "sparse_tokens": 14447.0,
      "step": 2621,
      "turn_loss": 0.3027651309967041,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12181750603976955,
      "grad_norm": 0.5071923136711121,
      "learning_rate": 8.945745289957631e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.009505926631391048,
      "mae_dx": 0.0018924573669210076,
      "mae_dy": 0.0021227174438536167,
      "pose_mae_dtheta": 0.06352073699235916,
      "pose_mae_dx": 0.022479193285107613,
      "pose_mae_dy": 0.029406283050775528,
      "pose_rmse_dtheta": 0.12215030193328857,
      "pose_rmse_dx": 0.05701947957277298,
      "pose_rmse_dy": 0.06560931354761124,
      "pose_rmse_mean": 0.08159302920103073,
      "rmse_dtheta": 0.019339460879564285,
      "rmse_dx": 0.005772836972028017,
      "rmse_dy": 0.004179440904408693,
      "rmse_mean": 0.009763913229107857,
      "rotation_flip": 0.004514672793447971,
      "sparse_tokens": 32089.0,
      "step": 2622,
      "turn_loss": 0.07286205887794495,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12186396580561235,
      "grad_norm": 0.6830281019210815,
      "learning_rate": 8.944933042726715e-06,
      "loss": 0.2027,
      "mae_dtheta": 0.010942689143121243,
      "mae_dx": 0.0017648496432229877,
      "mae_dy": 0.002087481552734971,
      "pose_mae_dtheta": 0.0798133984208107,
      "pose_mae_dx": 0.021722951903939247,
      "pose_mae_dy": 0.03016027808189392,
      "pose_rmse_dtheta": 0.18715259432792664,
      "pose_rmse_dx": 0.06554076820611954,
      "pose_rmse_dy": 0.07527515292167664,
      "pose_rmse_mean": 0.10932283848524094,
      "rmse_dtheta": 0.023872729390859604,
      "rmse_dx": 0.00531746493652463,
      "rmse_dy": 0.005167981144040823,
      "rmse_mean": 0.011452725157141685,
      "rotation_flip": 0.004533091560006142,
      "sparse_tokens": 32089.0,
      "step": 2623,
      "turn_loss": 0.0837721973657608,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12191042557145512,
      "grad_norm": 0.48993971943855286,
      "learning_rate": 8.944120519624512e-06,
      "loss": 0.1371,
      "mae_dtheta": 0.008165000937879086,
      "mae_dx": 0.001376403379254043,
      "mae_dy": 0.0019317376427352428,
      "pose_mae_dtheta": 0.05509624630212784,
      "pose_mae_dx": 0.021054640412330627,
      "pose_mae_dy": 0.028342347592115402,
      "pose_rmse_dtheta": 0.10394808650016785,
      "pose_rmse_dx": 0.05124087631702423,
      "pose_rmse_dy": 0.06361554563045502,
      "pose_rmse_mean": 0.0729348361492157,
      "rmse_dtheta": 0.015676677227020264,
      "rmse_dx": 0.003893392626196146,
      "rmse_dy": 0.00383179122582078,
      "rmse_mean": 0.007800620049238205,
      "rotation_flip": 0.004116920754313469,
      "sparse_tokens": 32073.0,
      "step": 2624,
      "turn_loss": 0.06634116172790527,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1219568853372979,
      "grad_norm": 0.4789729416370392,
      "learning_rate": 8.943307720707846e-06,
      "loss": 0.118,
      "mae_dtheta": 0.015835195779800415,
      "mae_dx": 0.002464697230607271,
      "mae_dy": 0.0047363778576254845,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4789729118347168,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 143.8086395263672,
      "model/head/act_norm_mean": 102.93187736742425,
      "model/head/act_norm_min": 62.618247985839844,
      "model/head/act_over_embed": 70.73574979031262,
      "model/head/grad_frac": 0.11585552990436554,
      "model/head/grad_norm": 0.05549165979027748,
      "model/head/grad_zero_frac": 0.00016561587108299136,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6894235321969697,
      "model/head/update_ratio": 0.0009593972936272621,
      "model/head/weight_delta": 5.952438831329346,
      "model/head/weight_delta_rel": 0.1044234111905098,
      "model/head/weight_norm": 57.840126037597656,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4153723120689392,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41530670166015626,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41523346304893494,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28540265354345934,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07803404331207275,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03737619146704674,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5316840277777778,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012136364821344614,
      "model/modality_embedder.encoders.pose/weight_delta": 1.9338489770889282,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06318487226963043,
      "model/modality_embedder.encoders.pose/weight_norm": 30.796859741210938,
      "model/modality_embedder/grad_frac": 0.07803404331207275,
      "model/modality_embedder/grad_norm": 0.03737619146704674,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5316840277777778,
      "model/modality_embedder/update_ratio": 0.0012136364821344614,
      "model/modality_embedder/weight_delta": 1.9338489770889282,
      "model/modality_embedder/weight_delta_rel": 0.06318487226963043,
      "model/modality_embedder/weight_norm": 30.796859741210938,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.66154479980469,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.82194464486131,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.92565631866455,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.683454022360765,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10089610517024994,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04832649976015091,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017476193606853485,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.263378381729126,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.046038269996643066,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.652761459350586,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.98128509521484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.851295695045696,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.57118034362793,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.390833700983837,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09351721405982971,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.044792212545871735,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015314797637984157,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.5810601711273193,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.054769158363342285,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.247669219970703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.90970611572266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.80184784351451,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.705916404724121,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.73127139876853,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10101094096899033,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0483815036714077,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016026364173740149,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.693480134010315,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05686389282345772,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.188695907592773,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.5385971069336,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.77326088263588,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.39586353302002,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.0860448959124,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1277620494365692,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06119455769658089,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020707265939563513,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.4426617622375488,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0493033342063427,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.552213668823242,
      "model/normalizer/grad_frac": 0.4390373229980469,
      "model/normalizer/grad_norm": 0.21028698980808258,
      "model/normalizer/grad_zero_frac": 0.00014889903832226992,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002693542744964361,
      "model/normalizer/weight_delta": 3.078951120376587,
      "model/normalizer/weight_delta_rel": 0.039655108004808426,
      "model/normalizer/weight_norm": 78.07078552246094,
      "pose_mae_dtheta": 0.1054934486746788,
      "pose_mae_dx": 0.03709946572780609,
      "pose_mae_dy": 0.050037212669849396,
      "pose_rmse_dtheta": 0.23663531243801117,
      "pose_rmse_dx": 0.08943019062280655,
      "pose_rmse_dy": 0.13310717046260834,
      "pose_rmse_mean": 0.15305756032466888,
      "rmse_dtheta": 0.029679032042622566,
      "rmse_dx": 0.00587816396728158,
      "rmse_dy": 0.011303811334073544,
      "rmse_mean": 0.015620335936546326,
      "rotation_flip": 0.0054209185764193535,
      "sparse_tokens": 32121.0,
      "step": 2625,
      "turn_loss": 0.14502641558647156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21357.0,
      "epoch": 0.12200334510314068,
      "grad_norm": 0.8405647873878479,
      "learning_rate": 8.942494646033555e-06,
      "loss": 0.2562,
      "mae_dtheta": 0.03246571496129036,
      "mae_dx": 0.013342393562197685,
      "mae_dy": 0.003296206472441554,
      "pose_mae_dtheta": 0.2627353370189667,
      "pose_mae_dx": 0.10640822350978851,
      "pose_mae_dy": 0.04669497534632683,
      "pose_rmse_dtheta": 0.44745367765426636,
      "pose_rmse_dx": 0.23777413368225098,
      "pose_rmse_dy": 0.1072348952293396,
      "pose_rmse_mean": 0.26415425539016724,
      "rmse_dtheta": 0.04850852116942406,
      "rmse_dx": 0.02685520052909851,
      "rmse_dy": 0.005935128312557936,
      "rmse_mean": 0.027099616825580597,
      "rotation_flip": 0.012168142013251781,
      "sparse_tokens": 15651.0,
      "step": 2626,
      "turn_loss": 0.250765323638916,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.12204980486898347,
      "grad_norm": 0.5675431489944458,
      "learning_rate": 8.941681295658496e-06,
      "loss": 0.1185,
      "mae_dtheta": 0.027977637946605682,
      "mae_dx": 0.009617732837796211,
      "mae_dy": 0.004063748754560947,
      "pose_mae_dtheta": 0.19589847326278687,
      "pose_mae_dx": 0.07415356487035751,
      "pose_mae_dy": 0.04311920702457428,
      "pose_rmse_dtheta": 0.3639664351940155,
      "pose_rmse_dx": 0.16750513017177582,
      "pose_rmse_dy": 0.0837618038058281,
      "pose_rmse_mean": 0.20507779717445374,
      "rmse_dtheta": 0.044167980551719666,
      "rmse_dx": 0.02017475850880146,
      "rmse_dy": 0.00688356114551425,
      "rmse_mean": 0.023742100223898888,
      "rotation_flip": 0.010909090749919415,
      "sparse_tokens": 13904.0,
      "step": 2627,
      "turn_loss": 0.1985330432653427,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.12209626463482624,
      "grad_norm": 0.5290629267692566,
      "learning_rate": 8.940867669639548e-06,
      "loss": 0.1231,
      "mae_dtheta": 0.03573284670710564,
      "mae_dx": 0.015031548216938972,
      "mae_dy": 0.005524604581296444,
      "pose_mae_dtheta": 0.3326711058616638,
      "pose_mae_dx": 0.1265769749879837,
      "pose_mae_dy": 0.06915833055973053,
      "pose_rmse_dtheta": 0.5422655940055847,
      "pose_rmse_dx": 0.26698270440101624,
      "pose_rmse_dy": 0.13730528950691223,
      "pose_rmse_mean": 0.3155178725719452,
      "rmse_dtheta": 0.05298345908522606,
      "rmse_dx": 0.02813996933400631,
      "rmse_dy": 0.009462547488510609,
      "rmse_mean": 0.03019532561302185,
      "rotation_flip": 0.014705882407724857,
      "sparse_tokens": 12317.0,
      "step": 2628,
      "turn_loss": 0.2890245318412781,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.12214272440066902,
      "grad_norm": 0.8773750066757202,
      "learning_rate": 8.94005376803361e-06,
      "loss": 0.1947,
      "mae_dtheta": 0.04069539159536362,
      "mae_dx": 0.019155442714691162,
      "mae_dy": 0.009360325522720814,
      "pose_mae_dtheta": 0.3169004023075104,
      "pose_mae_dx": 0.14799800515174866,
      "pose_mae_dy": 0.08709397912025452,
      "pose_rmse_dtheta": 0.48136767745018005,
      "pose_rmse_dx": 0.29115286469459534,
      "pose_rmse_dy": 0.16667988896369934,
      "pose_rmse_mean": 0.3130668103694916,
      "rmse_dtheta": 0.05461476743221283,
      "rmse_dx": 0.03202575072646141,
      "rmse_dy": 0.016924774274230003,
      "rmse_mean": 0.034521766006946564,
      "rotation_flip": 0.02634730562567711,
      "sparse_tokens": 14534.0,
      "step": 2629,
      "turn_loss": 0.32874926924705505,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1221891841665118,
      "grad_norm": 0.6671870350837708,
      "learning_rate": 8.939239590897596e-06,
      "loss": 0.2102,
      "mae_dtheta": 0.01543701346963644,
      "mae_dx": 0.003898188006132841,
      "mae_dy": 0.004825558513402939,
      "pose_mae_dtheta": 0.10821545869112015,
      "pose_mae_dx": 0.04673336446285248,
      "pose_mae_dy": 0.04750245809555054,
      "pose_rmse_dtheta": 0.22929570078849792,
      "pose_rmse_dx": 0.10968297719955444,
      "pose_rmse_dy": 0.11196257919073105,
      "pose_rmse_mean": 0.15031376481056213,
      "rmse_dtheta": 0.028528692200779915,
      "rmse_dx": 0.010862153023481369,
      "rmse_dy": 0.010481957346200943,
      "rmse_mean": 0.016624268144369125,
      "rotation_flip": 0.0045886593870818615,
      "sparse_tokens": 32121.0,
      "step": 2630,
      "turn_loss": 0.1502745896577835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12223564393235459,
      "grad_norm": 0.5315231680870056,
      "learning_rate": 8.938425138288445e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.009052067063748837,
      "mae_dx": 0.0020575213711708784,
      "mae_dy": 0.0022545496467500925,
      "pose_mae_dtheta": 0.06567168235778809,
      "pose_mae_dx": 0.027177143841981888,
      "pose_mae_dy": 0.032335929572582245,
      "pose_rmse_dtheta": 0.1556425839662552,
      "pose_rmse_dx": 0.07405855506658554,
      "pose_rmse_dy": 0.09909330308437347,
      "pose_rmse_mean": 0.10959814488887787,
      "rmse_dtheta": 0.019388701766729355,
      "rmse_dx": 0.006436805706471205,
      "rmse_dy": 0.006152288522571325,
      "rmse_mean": 0.010659265331923962,
      "rotation_flip": 0.006247211247682571,
      "sparse_tokens": 32089.0,
      "step": 2631,
      "turn_loss": 0.07911549508571625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14251.0,
      "epoch": 0.12228210369819736,
      "grad_norm": 0.5182336568832397,
      "learning_rate": 8.93761041026311e-06,
      "loss": 0.1268,
      "mae_dtheta": 0.0307686235755682,
      "mae_dx": 0.012235262431204319,
      "mae_dy": 0.0041429512202739716,
      "pose_mae_dtheta": 0.23444907367229462,
      "pose_mae_dx": 0.09589023143053055,
      "pose_mae_dy": 0.057254608720541,
      "pose_rmse_dtheta": 0.4300951063632965,
      "pose_rmse_dx": 0.24413613975048065,
      "pose_rmse_dy": 0.1262517273426056,
      "pose_rmse_mean": 0.26682767271995544,
      "rmse_dtheta": 0.04621828347444534,
      "rmse_dx": 0.026313334703445435,
      "rmse_dy": 0.00729798711836338,
      "rmse_mean": 0.026609867811203003,
      "rotation_flip": 0.007751937955617905,
      "sparse_tokens": 11734.0,
      "step": 2632,
      "turn_loss": 0.2107502967119217,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 24987.0,
      "epoch": 0.12232856346404014,
      "grad_norm": 0.47741004824638367,
      "learning_rate": 8.936795406878565e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.03451243042945862,
      "mae_dx": 0.015834249556064606,
      "mae_dy": 0.005418736487627029,
      "pose_mae_dtheta": 0.2747330963611603,
      "pose_mae_dx": 0.12364151328802109,
      "pose_mae_dy": 0.06653539091348648,
      "pose_rmse_dtheta": 0.48521682620048523,
      "pose_rmse_dx": 0.26335665583610535,
      "pose_rmse_dy": 0.19120045006275177,
      "pose_rmse_mean": 0.31325799226760864,
      "rmse_dtheta": 0.053131964057683945,
      "rmse_dx": 0.029175985604524612,
      "rmse_dy": 0.01375806424766779,
      "rmse_mean": 0.032022006809711456,
      "rotation_flip": 0.009700176306068897,
      "sparse_tokens": 19590.0,
      "step": 2633,
      "turn_loss": 0.2757699191570282,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 20776.0,
      "epoch": 0.12237502322988292,
      "grad_norm": 1.3491533994674683,
      "learning_rate": 8.935980128191803e-06,
      "loss": 0.2609,
      "mae_dtheta": 0.037464071065187454,
      "mae_dx": 0.014959123916924,
      "mae_dy": 0.003841463476419449,
      "pose_mae_dtheta": 0.27812790870666504,
      "pose_mae_dx": 0.12331876903772354,
      "pose_mae_dy": 0.05028602480888367,
      "pose_rmse_dtheta": 0.5012352466583252,
      "pose_rmse_dx": 0.2860530614852905,
      "pose_rmse_dy": 0.11546257883310318,
      "pose_rmse_mean": 0.30091696977615356,
      "rmse_dtheta": 0.05697498843073845,
      "rmse_dx": 0.029702387750148773,
      "rmse_dy": 0.007572313770651817,
      "rmse_mean": 0.03141656517982483,
      "rotation_flip": 0.0151869161054492,
      "sparse_tokens": 16700.0,
      "step": 2634,
      "turn_loss": 0.2132086455821991,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.12242148299572571,
      "grad_norm": 0.7817180752754211,
      "learning_rate": 8.935164574259838e-06,
      "loss": 0.1852,
      "mae_dtheta": 0.03568492457270622,
      "mae_dx": 0.012935030274093151,
      "mae_dy": 0.004269154276698828,
      "pose_mae_dtheta": 0.303587406873703,
      "pose_mae_dx": 0.09492126107215881,
      "pose_mae_dy": 0.058873649686574936,
      "pose_rmse_dtheta": 0.5850412845611572,
      "pose_rmse_dx": 0.24067701399326324,
      "pose_rmse_dy": 0.1594723016023636,
      "pose_rmse_mean": 0.32839685678482056,
      "rmse_dtheta": 0.056022223085165024,
      "rmse_dx": 0.027073603123426437,
      "rmse_dy": 0.009025046601891518,
      "rmse_mean": 0.03070695698261261,
      "rotation_flip": 0.0051282052882015705,
      "sparse_tokens": 3218.0,
      "step": 2635,
      "turn_loss": 0.23142410814762115,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.12246794276156849,
      "grad_norm": 0.7699316740036011,
      "learning_rate": 8.934348745139703e-06,
      "loss": 0.1281,
      "mae_dtheta": 0.04919851943850517,
      "mae_dx": 0.010287748649716377,
      "mae_dy": 0.0054548922926187515,
      "pose_mae_dtheta": 0.3791744112968445,
      "pose_mae_dx": 0.09074666351079941,
      "pose_mae_dy": 0.053440649062395096,
      "pose_rmse_dtheta": 0.6197306513786316,
      "pose_rmse_dx": 0.23280271887779236,
      "pose_rmse_dy": 0.12613724172115326,
      "pose_rmse_mean": 0.32622355222702026,
      "rmse_dtheta": 0.0701647475361824,
      "rmse_dx": 0.02282620221376419,
      "rmse_dy": 0.013171509839594364,
      "rmse_mean": 0.03538748621940613,
      "rotation_flip": 0.013280212879180908,
      "sparse_tokens": 10512.0,
      "step": 2636,
      "turn_loss": 0.42762312293052673,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.12251440252741126,
      "grad_norm": 0.5242165923118591,
      "learning_rate": 8.93353264088845e-06,
      "loss": 0.1011,
      "mae_dtheta": 0.010668836534023285,
      "mae_dx": 0.002283174777403474,
      "mae_dy": 0.002600952982902527,
      "pose_mae_dtheta": 0.07161857932806015,
      "pose_mae_dx": 0.0226774662733078,
      "pose_mae_dy": 0.028429795056581497,
      "pose_rmse_dtheta": 0.16476449370384216,
      "pose_rmse_dx": 0.057483330368995667,
      "pose_rmse_dy": 0.06589597463607788,
      "pose_rmse_mean": 0.09604793787002563,
      "rmse_dtheta": 0.021507075056433678,
      "rmse_dx": 0.006586276460438967,
      "rmse_dy": 0.005819939076900482,
      "rmse_mean": 0.011304430663585663,
      "rotation_flip": 0.0024187974631786346,
      "sparse_tokens": 32137.0,
      "step": 2637,
      "turn_loss": 0.08882403373718262,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.12256086229325404,
      "grad_norm": 0.5023249387741089,
      "learning_rate": 8.932716261563146e-06,
      "loss": 0.0973,
      "mae_dtheta": 0.008240626193583012,
      "mae_dx": 0.0022608276922255754,
      "mae_dy": 0.0022129681892693043,
      "pose_mae_dtheta": 0.0630652904510498,
      "pose_mae_dx": 0.025309033691883087,
      "pose_mae_dy": 0.021774141117930412,
      "pose_rmse_dtheta": 0.188161239027977,
      "pose_rmse_dx": 0.07046631723642349,
      "pose_rmse_dy": 0.05247238650918007,
      "pose_rmse_mean": 0.10369998216629028,
      "rmse_dtheta": 0.020848363637924194,
      "rmse_dx": 0.006657631602138281,
      "rmse_dy": 0.005682722199708223,
      "rmse_mean": 0.011062907055020332,
      "rotation_flip": 0.0027137042488902807,
      "sparse_tokens": 32137.0,
      "step": 2638,
      "turn_loss": 0.07569775730371475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6843.0,
      "epoch": 0.12260732205909682,
      "grad_norm": 1.2296149730682373,
      "learning_rate": 8.931899607220885e-06,
      "loss": 0.3214,
      "mae_dtheta": 0.035689275711774826,
      "mae_dx": 0.01646718569099903,
      "mae_dy": 0.00282134092412889,
      "pose_mae_dtheta": 0.2787538468837738,
      "pose_mae_dx": 0.1245122104883194,
      "pose_mae_dy": 0.023864533752202988,
      "pose_rmse_dtheta": 0.4923422634601593,
      "pose_rmse_dx": 0.2592989504337311,
      "pose_rmse_dy": 0.05312089994549751,
      "pose_rmse_mean": 0.26825404167175293,
      "rmse_dtheta": 0.05441917106509209,
      "rmse_dx": 0.02923295646905899,
      "rmse_dy": 0.006026317365467548,
      "rmse_mean": 0.0298928152769804,
      "rotation_flip": 0.009933775290846825,
      "sparse_tokens": 5232.0,
      "step": 2639,
      "turn_loss": 0.31390801072120667,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 18450.0,
      "epoch": 0.1226537818249396,
      "grad_norm": 0.5885019898414612,
      "learning_rate": 8.931082677918771e-06,
      "loss": 0.1061,
      "mae_dtheta": 0.037843815982341766,
      "mae_dx": 0.014735509641468525,
      "mae_dy": 0.004679061006754637,
      "pose_mae_dtheta": 0.31913867592811584,
      "pose_mae_dx": 0.13127301633358002,
      "pose_mae_dy": 0.06561165302991867,
      "pose_rmse_dtheta": 0.5704416036605835,
      "pose_rmse_dx": 0.2810421586036682,
      "pose_rmse_dy": 0.14490582048892975,
      "pose_rmse_mean": 0.3321298658847809,
      "rmse_dtheta": 0.05699261650443077,
      "rmse_dx": 0.028484147042036057,
      "rmse_dy": 0.009116295725107193,
      "rmse_mean": 0.03153102099895477,
      "rotation_flip": 0.005141388159245253,
      "sparse_tokens": 14601.0,
      "step": 2640,
      "turn_loss": 0.2957945764064789,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.12270024159078238,
      "grad_norm": 0.5711573958396912,
      "learning_rate": 8.930265473713939e-06,
      "loss": 0.1222,
      "mae_dtheta": 0.008710975758731365,
      "mae_dx": 0.001851417706348002,
      "mae_dy": 0.0015004657907411456,
      "pose_mae_dtheta": 0.06242253631353378,
      "pose_mae_dx": 0.018098952248692513,
      "pose_mae_dy": 0.01943095028400421,
      "pose_rmse_dtheta": 0.1768297553062439,
      "pose_rmse_dx": 0.049153074622154236,
      "pose_rmse_dy": 0.06975460052490234,
      "pose_rmse_mean": 0.09857915341854095,
      "rmse_dtheta": 0.0219588503241539,
      "rmse_dx": 0.006113454233855009,
      "rmse_dy": 0.00414634495973587,
      "rmse_mean": 0.010739549994468689,
      "rotation_flip": 0.0031014620326459408,
      "sparse_tokens": 32169.0,
      "step": 2641,
      "turn_loss": 0.06350883096456528,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12274670135662516,
      "grad_norm": 0.6060656905174255,
      "learning_rate": 8.92944799466353e-06,
      "loss": 0.1269,
      "mae_dtheta": 0.010930073447525501,
      "mae_dx": 0.0027125671040266752,
      "mae_dy": 0.0032143057323992252,
      "pose_mae_dtheta": 0.07937325537204742,
      "pose_mae_dx": 0.030588550493121147,
      "pose_mae_dy": 0.039276450872421265,
      "pose_rmse_dtheta": 0.18615353107452393,
      "pose_rmse_dx": 0.08158014714717865,
      "pose_rmse_dy": 0.09460694342851639,
      "pose_rmse_mean": 0.12078021466732025,
      "rmse_dtheta": 0.023033492267131805,
      "rmse_dx": 0.00807877816259861,
      "rmse_dy": 0.007123113144189119,
      "rmse_mean": 0.012745128944516182,
      "rotation_flip": 0.00716524850577116,
      "sparse_tokens": 32073.0,
      "step": 2642,
      "turn_loss": 0.10501889139413834,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12313.0,
      "epoch": 0.12279316112246794,
      "grad_norm": 0.39207759499549866,
      "learning_rate": 8.928630240824716e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.03986748307943344,
      "mae_dx": 0.012366265058517456,
      "mae_dy": 0.0057141100987792015,
      "pose_mae_dtheta": 0.32023122906684875,
      "pose_mae_dx": 0.10504952073097229,
      "pose_mae_dy": 0.06594685465097427,
      "pose_rmse_dtheta": 0.5286921262741089,
      "pose_rmse_dx": 0.2527936100959778,
      "pose_rmse_dy": 0.127828910946846,
      "pose_rmse_mean": 0.30310487747192383,
      "rmse_dtheta": 0.057206496596336365,
      "rmse_dx": 0.026212569326162338,
      "rmse_dy": 0.011550049297511578,
      "rmse_mean": 0.03165637329220772,
      "rotation_flip": 0.020168067887425423,
      "sparse_tokens": 10373.0,
      "step": 2643,
      "turn_loss": 0.3412134349346161,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.12283962088831073,
      "grad_norm": 0.5814881324768066,
      "learning_rate": 8.927812212254678e-06,
      "loss": 0.1332,
      "mae_dtheta": 0.009099779650568962,
      "mae_dx": 0.0032858860213309526,
      "mae_dy": 0.0019492716528475285,
      "pose_mae_dtheta": 0.06520014256238937,
      "pose_mae_dx": 0.02964962273836136,
      "pose_mae_dy": 0.025604138150811195,
      "pose_rmse_dtheta": 0.14855600893497467,
      "pose_rmse_dx": 0.0691133365035057,
      "pose_rmse_dy": 0.06462772190570831,
      "pose_rmse_mean": 0.0940990298986435,
      "rmse_dtheta": 0.020181499421596527,
      "rmse_dx": 0.009288349188864231,
      "rmse_dy": 0.004389978479593992,
      "rmse_mean": 0.011286608874797821,
      "rotation_flip": 0.004570004064589739,
      "sparse_tokens": 32185.0,
      "step": 2644,
      "turn_loss": 0.10669958591461182,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1228860806541535,
      "grad_norm": 0.536544144153595,
      "learning_rate": 8.926993909010626e-06,
      "loss": 0.1028,
      "mae_dtheta": 0.010040787048637867,
      "mae_dx": 0.0012703367974609137,
      "mae_dy": 0.0016272887587547302,
      "pose_mae_dtheta": 0.06820221990346909,
      "pose_mae_dx": 0.014565634541213512,
      "pose_mae_dy": 0.02429295890033245,
      "pose_rmse_dtheta": 0.1860237866640091,
      "pose_rmse_dx": 0.032581962645053864,
      "pose_rmse_dy": 0.05362389236688614,
      "pose_rmse_mean": 0.09074321389198303,
      "rmse_dtheta": 0.0221432913094759,
      "rmse_dx": 0.003923243377357721,
      "rmse_dy": 0.003474952420219779,
      "rmse_mean": 0.009847162291407585,
      "rotation_flip": 0.0029215358663350344,
      "sparse_tokens": 32089.0,
      "step": 2645,
      "turn_loss": 0.073379747569561,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.12293254041999628,
      "grad_norm": 0.7973119020462036,
      "learning_rate": 8.926175331149783e-06,
      "loss": 0.2564,
      "mae_dtheta": 0.02993302419781685,
      "mae_dx": 0.012058395892381668,
      "mae_dy": 0.006829210557043552,
      "pose_mae_dtheta": 0.24203220009803772,
      "pose_mae_dx": 0.10474415123462677,
      "pose_mae_dy": 0.10241594165563583,
      "pose_rmse_dtheta": 0.41419610381126404,
      "pose_rmse_dx": 0.24856799840927124,
      "pose_rmse_dy": 0.20377951860427856,
      "pose_rmse_mean": 0.2888478636741638,
      "rmse_dtheta": 0.044886160641908646,
      "rmse_dx": 0.025752229616045952,
      "rmse_dy": 0.01230713352560997,
      "rmse_mean": 0.027648508548736572,
      "rotation_flip": 0.019999999552965164,
      "sparse_tokens": 8709.0,
      "step": 2646,
      "turn_loss": 0.24201145768165588,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12297900018583906,
      "grad_norm": 0.6333891749382019,
      "learning_rate": 8.925356478729389e-06,
      "loss": 0.1538,
      "mae_dtheta": 0.011059748940169811,
      "mae_dx": 0.002154290908947587,
      "mae_dy": 0.0020571171771734953,
      "pose_mae_dtheta": 0.07012297958135605,
      "pose_mae_dx": 0.023715009912848473,
      "pose_mae_dy": 0.02780887670814991,
      "pose_rmse_dtheta": 0.16988670825958252,
      "pose_rmse_dx": 0.06972088664770126,
      "pose_rmse_dy": 0.06995563209056854,
      "pose_rmse_mean": 0.10318773984909058,
      "rmse_dtheta": 0.02439490333199501,
      "rmse_dx": 0.007410024292767048,
      "rmse_dy": 0.004754315596073866,
      "rmse_mean": 0.012186414562165737,
      "rotation_flip": 0.009548611007630825,
      "sparse_tokens": 32105.0,
      "step": 2647,
      "turn_loss": 0.10173245519399643,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.12302545995168185,
      "grad_norm": 1.3237439393997192,
      "learning_rate": 8.92453735180671e-06,
      "loss": 0.2068,
      "mae_dtheta": 0.03341437131166458,
      "mae_dx": 0.012135401368141174,
      "mae_dy": 0.0044990344904363155,
      "pose_mae_dtheta": 0.2767859995365143,
      "pose_mae_dx": 0.0914156511425972,
      "pose_mae_dy": 0.06601423770189285,
      "pose_rmse_dtheta": 0.46582573652267456,
      "pose_rmse_dx": 0.2195921093225479,
      "pose_rmse_dy": 0.13386034965515137,
      "pose_rmse_mean": 0.27309274673461914,
      "rmse_dtheta": 0.05068877711892128,
      "rmse_dx": 0.025273624807596207,
      "rmse_dy": 0.0072128972969949245,
      "rmse_mean": 0.02772510051727295,
      "rotation_flip": 0.014951626770198345,
      "sparse_tokens": 21798.0,
      "step": 2648,
      "turn_loss": 0.2578103542327881,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.12307191971752462,
      "grad_norm": 0.5627427101135254,
      "learning_rate": 8.92371795043903e-06,
      "loss": 0.1085,
      "mae_dtheta": 0.02169029787182808,
      "mae_dx": 0.01429617777466774,
      "mae_dy": 0.001618573791347444,
      "pose_mae_dtheta": 0.1800891011953354,
      "pose_mae_dx": 0.11018897593021393,
      "pose_mae_dy": 0.01712631992995739,
      "pose_rmse_dtheta": 0.36468303203582764,
      "pose_rmse_dx": 0.26239827275276184,
      "pose_rmse_dy": 0.03916166350245476,
      "pose_rmse_mean": 0.2220809906721115,
      "rmse_dtheta": 0.03870663791894913,
      "rmse_dx": 0.028461910784244537,
      "rmse_dy": 0.003591101849451661,
      "rmse_mean": 0.02358655259013176,
      "rotation_flip": 0.00871459674090147,
      "sparse_tokens": 13525.0,
      "step": 2649,
      "turn_loss": 0.1767105907201767,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1231183794833674,
      "grad_norm": 0.5565860867500305,
      "learning_rate": 8.922898274683644e-06,
      "loss": 0.1308,
      "mae_dtheta": 0.011338888667523861,
      "mae_dx": 0.0014651772798970342,
      "mae_dy": 0.00258207437582314,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.556585967540741,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.53057861328125,
      "model/head/act_norm_mean": 115.17536695075758,
      "model/head/act_norm_min": 80.2697525024414,
      "model/head/act_over_embed": 79.14959045733471,
      "model/head/grad_frac": 0.11388614773750305,
      "model/head/grad_norm": 0.063387431204319,
      "model/head/grad_zero_frac": 0.00021637935424223542,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6943162089646465,
      "model/head/update_ratio": 0.0010957496706396341,
      "model/head/weight_delta": 5.988426208496094,
      "model/head/weight_delta_rel": 0.10505473613739014,
      "model/head/weight_norm": 57.84846115112305,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4154037833213806,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4153364682527182,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.415274977684021,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28542310942454713,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08237560093402863,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04584910348057747,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5415826612903226,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014886843273416162,
      "model/modality_embedder.encoders.pose/weight_delta": 1.9494935274124146,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06369602680206299,
      "model/modality_embedder.encoders.pose/weight_norm": 30.798404693603516,
      "model/modality_embedder/grad_frac": 0.08237560093402863,
      "model/modality_embedder/grad_norm": 0.04584910348057747,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5415826612903226,
      "model/modality_embedder/update_ratio": 0.0014886843273416162,
      "model/modality_embedder/weight_delta": 1.9494935274124146,
      "model/modality_embedder/weight_delta_rel": 0.06369602680206299,
      "model/modality_embedder/weight_norm": 30.798404693603516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.28528594970703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.972971280262946,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.936280250549316,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.47445030228991,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1087915226817131,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06055183336138725,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0021895477548241615,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.273436427116394,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04640479013323784,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.654949188232422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.10647583007812,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.030423280423282,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.315620422363281,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.201141216821693,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09858453273773193,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.054870765656232834,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018758540973067284,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.5940977334976196,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05522079020738602,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.251083374023438,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.81861114501953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.006012506012507,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.352306365966797,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.558784628404347,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.12742292881011963,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07092181593179703,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002349025337025523,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.7082513570785522,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.057359881699085236,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.192018508911133,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.82420349121094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.88578994308161,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.62893009185791,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.85058528191187,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.15458178520202637,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08603805303573608,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0029111423064023256,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.4548789262771606,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.04972085729241371,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.554738998413086,
      "model/normalizer/grad_frac": 0.6220303177833557,
      "model/normalizer/grad_norm": 0.34621334075927734,
      "model/normalizer/grad_zero_frac": 0.00018080597510561347,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0044344044290483,
      "model/normalizer/weight_delta": 3.104680061340332,
      "model/normalizer/weight_delta_rel": 0.03998648002743721,
      "model/normalizer/weight_norm": 78.07437133789062,
      "pose_mae_dtheta": 0.07731355726718903,
      "pose_mae_dx": 0.02295771986246109,
      "pose_mae_dy": 0.03329187631607056,
      "pose_rmse_dtheta": 0.1573711782693863,
      "pose_rmse_dx": 0.05517518147826195,
      "pose_rmse_dy": 0.07410798966884613,
      "pose_rmse_mean": 0.09555145353078842,
      "rmse_dtheta": 0.021709833294153214,
      "rmse_dx": 0.004369891714304686,
      "rmse_dy": 0.005184622947126627,
      "rmse_mean": 0.01042145024985075,
      "rotation_flip": 0.005803409498184919,
      "sparse_tokens": 32057.0,
      "step": 2650,
      "turn_loss": 0.08387415111064911,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.12316483924921018,
      "grad_norm": 0.7172030806541443,
      "learning_rate": 8.92207832459788e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.007526857778429985,
      "mae_dx": 0.001969624310731888,
      "mae_dy": 0.0009602672071196139,
      "pose_mae_dtheta": 0.055791787803173065,
      "pose_mae_dx": 0.018893370404839516,
      "pose_mae_dy": 0.013208655640482903,
      "pose_rmse_dtheta": 0.18137377500534058,
      "pose_rmse_dx": 0.05111552029848099,
      "pose_rmse_dy": 0.033016882836818695,
      "pose_rmse_mean": 0.08850206434726715,
      "rmse_dtheta": 0.021880662068724632,
      "rmse_dx": 0.005398792680352926,
      "rmse_dy": 0.0023350934498012066,
      "rmse_mean": 0.00987151637673378,
      "rotation_flip": 0.005045408848673105,
      "sparse_tokens": 32169.0,
      "step": 2651,
      "turn_loss": 0.0618036650121212,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12321129901505297,
      "grad_norm": 0.5920417308807373,
      "learning_rate": 8.921258100239072e-06,
      "loss": 0.1571,
      "mae_dtheta": 0.011503713205456734,
      "mae_dx": 0.002229400910437107,
      "mae_dy": 0.002938443562015891,
      "pose_mae_dtheta": 0.08061772584915161,
      "pose_mae_dx": 0.02434547245502472,
      "pose_mae_dy": 0.0371227040886879,
      "pose_rmse_dtheta": 0.16186991333961487,
      "pose_rmse_dx": 0.056587789207696915,
      "pose_rmse_dy": 0.08839944005012512,
      "pose_rmse_mean": 0.1022857129573822,
      "rmse_dtheta": 0.02181701734662056,
      "rmse_dx": 0.006620323751121759,
      "rmse_dy": 0.006409329362213612,
      "rmse_mean": 0.011615557596087456,
      "rotation_flip": 0.0033613445702940226,
      "sparse_tokens": 32121.0,
      "step": 2652,
      "turn_loss": 0.0949183851480484,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12325775878089575,
      "grad_norm": 0.4288520812988281,
      "learning_rate": 8.92043760166458e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.010032858699560165,
      "mae_dx": 0.001948242075741291,
      "mae_dy": 0.0021611659321933985,
      "pose_mae_dtheta": 0.07050676643848419,
      "pose_mae_dx": 0.02649867720901966,
      "pose_mae_dy": 0.0316111259162426,
      "pose_rmse_dtheta": 0.14108245074748993,
      "pose_rmse_dx": 0.06715896725654602,
      "pose_rmse_dy": 0.07516951113939285,
      "pose_rmse_mean": 0.09447031468153,
      "rmse_dtheta": 0.018450353294610977,
      "rmse_dx": 0.005879624746739864,
      "rmse_dy": 0.004428229760378599,
      "rmse_mean": 0.009586069732904434,
      "rotation_flip": 0.005645464640110731,
      "sparse_tokens": 32105.0,
      "step": 2653,
      "turn_loss": 0.08179397135972977,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.12330421854673852,
      "grad_norm": 0.6714099645614624,
      "learning_rate": 8.919616828931783e-06,
      "loss": 0.1489,
      "mae_dtheta": 0.03840089961886406,
      "mae_dx": 0.012771286070346832,
      "mae_dy": 0.0053974841721355915,
      "pose_mae_dtheta": 0.3205380141735077,
      "pose_mae_dx": 0.1019565537571907,
      "pose_mae_dy": 0.05268564820289612,
      "pose_rmse_dtheta": 0.5469088554382324,
      "pose_rmse_dx": 0.224684476852417,
      "pose_rmse_dy": 0.1109839379787445,
      "pose_rmse_mean": 0.29419243335723877,
      "rmse_dtheta": 0.056220848113298416,
      "rmse_dx": 0.024857934564352036,
      "rmse_dy": 0.011144202202558517,
      "rmse_mean": 0.030740996822714806,
      "rotation_flip": 0.01669449172914028,
      "sparse_tokens": 10039.0,
      "step": 2654,
      "turn_loss": 0.30949512124061584,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 35902.0,
      "epoch": 0.1233506783125813,
      "grad_norm": 0.6202977895736694,
      "learning_rate": 8.918795782098075e-06,
      "loss": 0.207,
      "mae_dtheta": 0.03620363026857376,
      "mae_dx": 0.016704414039850235,
      "mae_dy": 0.004680484067648649,
      "pose_mae_dtheta": 0.28483325242996216,
      "pose_mae_dx": 0.13327500224113464,
      "pose_mae_dy": 0.06106891110539436,
      "pose_rmse_dtheta": 0.4621775150299072,
      "pose_rmse_dx": 0.26941177248954773,
      "pose_rmse_dy": 0.13743744790554047,
      "pose_rmse_mean": 0.28967559337615967,
      "rmse_dtheta": 0.051744475960731506,
      "rmse_dx": 0.029489004984498024,
      "rmse_dy": 0.008693613111972809,
      "rmse_mean": 0.02997569739818573,
      "rotation_flip": 0.014018691144883633,
      "sparse_tokens": 29125.0,
      "step": 2655,
      "turn_loss": 0.32148805260658264,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.12339713807842409,
      "grad_norm": 0.5732622146606445,
      "learning_rate": 8.917974461220877e-06,
      "loss": 0.0968,
      "mae_dtheta": 0.015233312733471394,
      "mae_dx": 0.003591887652873993,
      "mae_dy": 0.005542181897908449,
      "pose_mae_dtheta": 0.10076340287923813,
      "pose_mae_dx": 0.04649028927087784,
      "pose_mae_dy": 0.05174175277352333,
      "pose_rmse_dtheta": 0.1899281144142151,
      "pose_rmse_dx": 0.10437652468681335,
      "pose_rmse_dy": 0.11563295125961304,
      "pose_rmse_mean": 0.1366458684206009,
      "rmse_dtheta": 0.027490688487887383,
      "rmse_dx": 0.008176053874194622,
      "rmse_dy": 0.011433573439717293,
      "rmse_mean": 0.01570010557770729,
      "rotation_flip": 0.012316010892391205,
      "sparse_tokens": 32137.0,
      "step": 2656,
      "turn_loss": 0.15940284729003906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.12344359784426687,
      "grad_norm": 0.45637762546539307,
      "learning_rate": 8.917152866357621e-06,
      "loss": 0.0877,
      "mae_dtheta": 0.0085318423807621,
      "mae_dx": 0.0020436691120266914,
      "mae_dy": 0.0018133774865418673,
      "pose_mae_dtheta": 0.06290173530578613,
      "pose_mae_dx": 0.026453133672475815,
      "pose_mae_dy": 0.0266021229326725,
      "pose_rmse_dtheta": 0.13320735096931458,
      "pose_rmse_dx": 0.09232346713542938,
      "pose_rmse_dy": 0.06775365024805069,
      "pose_rmse_mean": 0.09776149690151215,
      "rmse_dtheta": 0.017403481528162956,
      "rmse_dx": 0.007741844281554222,
      "rmse_dy": 0.003897115821018815,
      "rmse_mean": 0.009680814109742641,
      "rotation_flip": 0.007841328158974648,
      "sparse_tokens": 32057.0,
      "step": 2657,
      "turn_loss": 0.06547299027442932,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12349005761010964,
      "grad_norm": 0.4481073021888733,
      "learning_rate": 8.916330997565764e-06,
      "loss": 0.0859,
      "mae_dtheta": 0.012451954185962677,
      "mae_dx": 0.0013693631626665592,
      "mae_dy": 0.002178159775212407,
      "pose_mae_dtheta": 0.08870238065719604,
      "pose_mae_dx": 0.021129056811332703,
      "pose_mae_dy": 0.03543388098478317,
      "pose_rmse_dtheta": 0.20689351856708527,
      "pose_rmse_dx": 0.04972580075263977,
      "pose_rmse_dy": 0.08261967450380325,
      "pose_rmse_mean": 0.11307966709136963,
      "rmse_dtheta": 0.025923505425453186,
      "rmse_dx": 0.004071815870702267,
      "rmse_dy": 0.0043360162526369095,
      "rmse_mean": 0.01144377887248993,
      "rotation_flip": 0.0035714285913854837,
      "sparse_tokens": 32089.0,
      "step": 2658,
      "turn_loss": 0.07526446133852005,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.12353651737595242,
      "grad_norm": 0.7392276525497437,
      "learning_rate": 8.915508854902778e-06,
      "loss": 0.2441,
      "mae_dtheta": 0.026756415143609047,
      "mae_dx": 0.008644724264740944,
      "mae_dy": 0.005461720284074545,
      "pose_mae_dtheta": 0.21675224602222443,
      "pose_mae_dx": 0.09187503159046173,
      "pose_mae_dy": 0.07765229046344757,
      "pose_rmse_dtheta": 0.4119364619255066,
      "pose_rmse_dx": 0.2003847062587738,
      "pose_rmse_dy": 0.16201797127723694,
      "pose_rmse_mean": 0.2581130266189575,
      "rmse_dtheta": 0.04396733269095421,
      "rmse_dx": 0.019125021994113922,
      "rmse_dy": 0.009656411595642567,
      "rmse_mean": 0.024249589070677757,
      "rotation_flip": 0.01342281885445118,
      "sparse_tokens": 8743.0,
      "step": 2659,
      "turn_loss": 0.25483304262161255,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.12358297714179521,
      "grad_norm": 0.44265973567962646,
      "learning_rate": 8.914686438426156e-06,
      "loss": 0.1335,
      "mae_dtheta": 0.015213222242891788,
      "mae_dx": 0.0039154463447630405,
      "mae_dy": 0.003709054086357355,
      "pose_mae_dtheta": 0.11972951889038086,
      "pose_mae_dx": 0.02801625244319439,
      "pose_mae_dy": 0.03477146103978157,
      "pose_rmse_dtheta": 0.3085751533508301,
      "pose_rmse_dx": 0.07836935669183731,
      "pose_rmse_dy": 0.10184571892023087,
      "pose_rmse_mean": 0.16293007135391235,
      "rmse_dtheta": 0.0358838252723217,
      "rmse_dx": 0.012627195566892624,
      "rmse_dy": 0.011221329681575298,
      "rmse_mean": 0.01991078443825245,
      "rotation_flip": 0.004657070152461529,
      "sparse_tokens": 32185.0,
      "step": 2660,
      "turn_loss": 0.15185260772705078,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.12362943690763799,
      "grad_norm": 0.5361335873603821,
      "learning_rate": 8.91386374819341e-06,
      "loss": 0.2002,
      "mae_dtheta": 0.03443700075149536,
      "mae_dx": 0.012047640979290009,
      "mae_dy": 0.004653912037611008,
      "pose_mae_dtheta": 0.27901849150657654,
      "pose_mae_dx": 0.09810897707939148,
      "pose_mae_dy": 0.06160620599985123,
      "pose_rmse_dtheta": 0.4879101812839508,
      "pose_rmse_dx": 0.18402482569217682,
      "pose_rmse_dy": 0.13808034360408783,
      "pose_rmse_mean": 0.27000513672828674,
      "rmse_dtheta": 0.05341287702322006,
      "rmse_dx": 0.022987738251686096,
      "rmse_dy": 0.008486268110573292,
      "rmse_mean": 0.02829562872648239,
      "rotation_flip": 0.01491053681820631,
      "sparse_tokens": 18953.0,
      "step": 2661,
      "turn_loss": 0.27255603671073914,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12367589667348076,
      "grad_norm": 0.5780003070831299,
      "learning_rate": 8.91304078426207e-06,
      "loss": 0.095,
      "mae_dtheta": 0.009618639014661312,
      "mae_dx": 0.0016956556355580688,
      "mae_dy": 0.002091449685394764,
      "pose_mae_dtheta": 0.06325278431177139,
      "pose_mae_dx": 0.018289465457201004,
      "pose_mae_dy": 0.023228468373417854,
      "pose_rmse_dtheta": 0.16020210087299347,
      "pose_rmse_dx": 0.04747955873608589,
      "pose_rmse_dy": 0.052795663475990295,
      "pose_rmse_mean": 0.08682577311992645,
      "rmse_dtheta": 0.021546291187405586,
      "rmse_dx": 0.005463366862386465,
      "rmse_dy": 0.005566439125686884,
      "rmse_mean": 0.010858699679374695,
      "rotation_flip": 0.0048629529774188995,
      "sparse_tokens": 32089.0,
      "step": 2662,
      "turn_loss": 0.08202023804187775,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.12372235643932354,
      "grad_norm": 0.4501587152481079,
      "learning_rate": 8.91221754668969e-06,
      "loss": 0.082,
      "mae_dtheta": 0.0291348434984684,
      "mae_dx": 0.0068464092910289764,
      "mae_dy": 0.0038028405979275703,
      "pose_mae_dtheta": 0.19983124732971191,
      "pose_mae_dx": 0.07418352365493774,
      "pose_mae_dy": 0.062475163489580154,
      "pose_rmse_dtheta": 0.421644389629364,
      "pose_rmse_dx": 0.2184106856584549,
      "pose_rmse_dy": 0.13110145926475525,
      "pose_rmse_mean": 0.2570521831512451,
      "rmse_dtheta": 0.04993229731917381,
      "rmse_dx": 0.019821826368570328,
      "rmse_dy": 0.0071747261099517345,
      "rmse_mean": 0.02564295008778572,
      "rotation_flip": 0.01568627543747425,
      "sparse_tokens": 4715.0,
      "step": 2663,
      "turn_loss": 0.224526509642601,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.12376881620516633,
      "grad_norm": 0.3929682970046997,
      "learning_rate": 8.911394035533836e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.026230791583657265,
      "mae_dx": 0.011455635540187359,
      "mae_dy": 0.0033950998913496733,
      "pose_mae_dtheta": 0.17653615772724152,
      "pose_mae_dx": 0.08742589503526688,
      "pose_mae_dy": 0.03389522433280945,
      "pose_rmse_dtheta": 0.40233156085014343,
      "pose_rmse_dx": 0.19298216700553894,
      "pose_rmse_dy": 0.07577075064182281,
      "pose_rmse_mean": 0.2236948311328888,
      "rmse_dtheta": 0.04408149793744087,
      "rmse_dx": 0.02358802780508995,
      "rmse_dy": 0.008057676255702972,
      "rmse_mean": 0.025242401286959648,
      "rotation_flip": 0.015625,
      "sparse_tokens": 7674.0,
      "step": 2664,
      "turn_loss": 0.21137596666812897,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12381527597100911,
      "grad_norm": 0.5034774541854858,
      "learning_rate": 8.910570250852098e-06,
      "loss": 0.1268,
      "mae_dtheta": 0.010009572841227055,
      "mae_dx": 0.0013168256264179945,
      "mae_dy": 0.001619882881641388,
      "pose_mae_dtheta": 0.06599979102611542,
      "pose_mae_dx": 0.015110466629266739,
      "pose_mae_dy": 0.025200728327035904,
      "pose_rmse_dtheta": 0.152761772274971,
      "pose_rmse_dx": 0.03267853334546089,
      "pose_rmse_dy": 0.0542294979095459,
      "pose_rmse_mean": 0.0798899382352829,
      "rmse_dtheta": 0.02266915887594223,
      "rmse_dx": 0.004018829669803381,
      "rmse_dy": 0.003226691856980324,
      "rmse_mean": 0.009971560910344124,
      "rotation_flip": 0.0062500000931322575,
      "sparse_tokens": 32105.0,
      "step": 2665,
      "turn_loss": 0.07664602994918823,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12386173573685189,
      "grad_norm": 0.6059686541557312,
      "learning_rate": 8.909746192702082e-06,
      "loss": 0.1456,
      "mae_dtheta": 0.009361430071294308,
      "mae_dx": 0.0018434436060488224,
      "mae_dy": 0.0024587397929280996,
      "pose_mae_dtheta": 0.06508052349090576,
      "pose_mae_dx": 0.024349458515644073,
      "pose_mae_dy": 0.026263756677508354,
      "pose_rmse_dtheta": 0.148664653301239,
      "pose_rmse_dx": 0.0602346733212471,
      "pose_rmse_dy": 0.061318542808294296,
      "pose_rmse_mean": 0.0900726243853569,
      "rmse_dtheta": 0.021328646689653397,
      "rmse_dx": 0.004809151403605938,
      "rmse_dy": 0.005741712171584368,
      "rmse_mean": 0.010626504197716713,
      "rotation_flip": 0.0028997515328228474,
      "sparse_tokens": 32105.0,
      "step": 2666,
      "turn_loss": 0.08853218704462051,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.12390819550269466,
      "grad_norm": 0.632193386554718,
      "learning_rate": 8.908921861141417e-06,
      "loss": 0.1271,
      "mae_dtheta": 0.04198336601257324,
      "mae_dx": 0.013956332579255104,
      "mae_dy": 0.006028366275131702,
      "pose_mae_dtheta": 0.3301255702972412,
      "pose_mae_dx": 0.09241528809070587,
      "pose_mae_dy": 0.04955428093671799,
      "pose_rmse_dtheta": 0.5610225796699524,
      "pose_rmse_dx": 0.20536577701568604,
      "pose_rmse_dy": 0.1650814265012741,
      "pose_rmse_mean": 0.3104899525642395,
      "rmse_dtheta": 0.06109720468521118,
      "rmse_dx": 0.02543925680220127,
      "rmse_dy": 0.015067107044160366,
      "rmse_mean": 0.03386785835027695,
      "rotation_flip": 0.012747875414788723,
      "sparse_tokens": 12567.0,
      "step": 2667,
      "turn_loss": 0.3172602653503418,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12395465526853745,
      "grad_norm": 0.41813036799430847,
      "learning_rate": 8.90809725622775e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.00966834556311369,
      "mae_dx": 0.001712928176857531,
      "mae_dy": 0.0018506209598854184,
      "pose_mae_dtheta": 0.06607607752084732,
      "pose_mae_dx": 0.017885277047753334,
      "pose_mae_dy": 0.020607739686965942,
      "pose_rmse_dtheta": 0.20491907000541687,
      "pose_rmse_dx": 0.047160256654024124,
      "pose_rmse_dy": 0.046742793172597885,
      "pose_rmse_mean": 0.09960737824440002,
      "rmse_dtheta": 0.023494558408856392,
      "rmse_dx": 0.005600768607109785,
      "rmse_dy": 0.005464409943670034,
      "rmse_mean": 0.011519912630319595,
      "rotation_flip": 0.0029952931217849255,
      "sparse_tokens": 32121.0,
      "step": 2668,
      "turn_loss": 0.08028638362884521,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.12400111503438023,
      "grad_norm": 0.4073607325553894,
      "learning_rate": 8.907272378018743e-06,
      "loss": 0.0912,
      "mae_dtheta": 0.02419469691812992,
      "mae_dx": 0.012016677297651768,
      "mae_dy": 0.0039564683102071285,
      "pose_mae_dtheta": 0.15549258887767792,
      "pose_mae_dx": 0.0973193496465683,
      "pose_mae_dy": 0.05457248166203499,
      "pose_rmse_dtheta": 0.3036925792694092,
      "pose_rmse_dx": 0.2374487817287445,
      "pose_rmse_dy": 0.14003965258598328,
      "pose_rmse_mean": 0.22706036269664764,
      "rmse_dtheta": 0.041772354394197464,
      "rmse_dx": 0.025482138618826866,
      "rmse_dy": 0.007665133103728294,
      "rmse_mean": 0.02497320994734764,
      "rotation_flip": 0.008438818156719208,
      "sparse_tokens": 13806.0,
      "step": 2669,
      "turn_loss": 0.2251112014055252,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 37313.0,
      "epoch": 0.124047574800223,
      "grad_norm": 0.6537635326385498,
      "learning_rate": 8.906447226572081e-06,
      "loss": 0.2048,
      "mae_dtheta": 0.029575755819678307,
      "mae_dx": 0.009031705558300018,
      "mae_dy": 0.004285978619009256,
      "pose_mae_dtheta": 0.23235264420509338,
      "pose_mae_dx": 0.07598846405744553,
      "pose_mae_dy": 0.048143014311790466,
      "pose_rmse_dtheta": 0.44573163986206055,
      "pose_rmse_dx": 0.18272562325000763,
      "pose_rmse_dy": 0.12287867814302444,
      "pose_rmse_mean": 0.25044530630111694,
      "rmse_dtheta": 0.04931851848959923,
      "rmse_dx": 0.0200195275247097,
      "rmse_dy": 0.009809725917875767,
      "rmse_mean": 0.02638259157538414,
      "rotation_flip": 0.01001251582056284,
      "sparse_tokens": 29667.0,
      "step": 2670,
      "turn_loss": 0.22489382326602936,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.12409403456606578,
      "grad_norm": 0.9517369270324707,
      "learning_rate": 8.905621801945467e-06,
      "loss": 0.2358,
      "mae_dtheta": 0.02867192029953003,
      "mae_dx": 0.009498768486082554,
      "mae_dy": 0.005576882045716047,
      "pose_mae_dtheta": 0.19719518721103668,
      "pose_mae_dx": 0.07767130434513092,
      "pose_mae_dy": 0.06664656102657318,
      "pose_rmse_dtheta": 0.35429492592811584,
      "pose_rmse_dx": 0.18281228840351105,
      "pose_rmse_dy": 0.13744038343429565,
      "pose_rmse_mean": 0.22484920918941498,
      "rmse_dtheta": 0.04626157134771347,
      "rmse_dx": 0.021090015769004822,
      "rmse_dy": 0.0104301106184721,
      "rmse_mean": 0.025927234441041946,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 10765.0,
      "step": 2671,
      "turn_loss": 0.20561222732067108,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.12414049433190857,
      "grad_norm": 0.5909547805786133,
      "learning_rate": 8.904796104196625e-06,
      "loss": 0.1108,
      "mae_dtheta": 0.014870946295559406,
      "mae_dx": 0.0034768537152558565,
      "mae_dy": 0.005687813274562359,
      "pose_mae_dtheta": 0.0974675714969635,
      "pose_mae_dx": 0.0504961833357811,
      "pose_mae_dy": 0.042530134320259094,
      "pose_rmse_dtheta": 0.2003684788942337,
      "pose_rmse_dx": 0.13072042167186737,
      "pose_rmse_dy": 0.10073208063840866,
      "pose_rmse_mean": 0.14394032955169678,
      "rmse_dtheta": 0.027731789276003838,
      "rmse_dx": 0.00779420742765069,
      "rmse_dy": 0.01191285066306591,
      "rmse_mean": 0.015812948346138,
      "rotation_flip": 0.009492634795606136,
      "sparse_tokens": 32137.0,
      "step": 2672,
      "turn_loss": 0.1553332805633545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30400.0,
      "epoch": 0.12418695409775135,
      "grad_norm": 0.5583904385566711,
      "learning_rate": 8.903970133383297e-06,
      "loss": 0.2024,
      "mae_dtheta": 0.04001397639513016,
      "mae_dx": 0.015148639678955078,
      "mae_dy": 0.006981828715652227,
      "pose_mae_dtheta": 0.3397786021232605,
      "pose_mae_dx": 0.1348067820072174,
      "pose_mae_dy": 0.0780387669801712,
      "pose_rmse_dtheta": 0.522772490978241,
      "pose_rmse_dx": 0.26054614782333374,
      "pose_rmse_dy": 0.1648738831281662,
      "pose_rmse_mean": 0.31606417894363403,
      "rmse_dtheta": 0.05504078045487404,
      "rmse_dx": 0.027139991521835327,
      "rmse_dy": 0.01309262029826641,
      "rmse_mean": 0.03175779804587364,
      "rotation_flip": 0.02704576961696148,
      "sparse_tokens": 25161.0,
      "step": 2673,
      "turn_loss": 0.3757286071777344,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12423341386359413,
      "grad_norm": 0.5538136959075928,
      "learning_rate": 8.903143889563241e-06,
      "loss": 0.1288,
      "mae_dtheta": 0.012058816850185394,
      "mae_dx": 0.002366239670664072,
      "mae_dy": 0.003344824770465493,
      "pose_mae_dtheta": 0.08103244751691818,
      "pose_mae_dx": 0.028652258217334747,
      "pose_mae_dy": 0.03594013303518295,
      "pose_rmse_dtheta": 0.18166828155517578,
      "pose_rmse_dx": 0.06533952057361603,
      "pose_rmse_dy": 0.08245342969894409,
      "pose_rmse_mean": 0.1098204106092453,
      "rmse_dtheta": 0.025955667719244957,
      "rmse_dx": 0.00735336821526289,
      "rmse_dy": 0.0075864531099796295,
      "rmse_mean": 0.013631829991936684,
      "rotation_flip": 0.00498575484380126,
      "sparse_tokens": 32105.0,
      "step": 2674,
      "turn_loss": 0.11482416093349457,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.1242798736294369,
      "grad_norm": 0.5343352556228638,
      "learning_rate": 8.902317372794238e-06,
      "loss": 0.0949,
      "mae_dtheta": 0.012318918481469154,
      "mae_dx": 0.0024306941777467728,
      "mae_dy": 0.0028711685445159674,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5343351364135742,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.64535522460938,
      "model/head/act_norm_mean": 108.63422309027777,
      "model/head/act_norm_min": 65.48445892333984,
      "model/head/act_over_embed": 74.65445515725933,
      "model/head/grad_frac": 0.08952711522579193,
      "model/head/grad_norm": 0.04783748462796211,
      "model/head/grad_zero_frac": 0.00018465216271579266,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6867059264520202,
      "model/head/update_ratio": 0.0008268553065136075,
      "model/head/weight_delta": 6.01908016204834,
      "model/head/weight_delta_rel": 0.10559249669313431,
      "model/head/weight_norm": 57.85472106933594,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4155429005622864,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41547653522897277,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4154109060764313,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28551936476195694,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08276836574077606,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04422604665160179,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5404172207446809,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014358534244820476,
      "model/modality_embedder.encoders.pose/weight_delta": 1.9655786752700806,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0642215833067894,
      "model/modality_embedder.encoders.pose/weight_norm": 30.801225662231445,
      "model/modality_embedder/grad_frac": 0.08276836574077606,
      "model/modality_embedder/grad_norm": 0.04422604665160179,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5404172207446809,
      "model/modality_embedder/update_ratio": 0.0014358534244820476,
      "model/modality_embedder/weight_delta": 1.9655786752700806,
      "model/modality_embedder/weight_delta_rel": 0.0642215833067894,
      "model/modality_embedder/weight_norm": 30.801225662231445,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.20008087158203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.386766975308642,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.872598648071289,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.07160521579414,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08037663996219635,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04294806346297264,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015528500080108643,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.2832070589065552,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.046760838478803635,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.657573699951172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.80235290527344,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.48597582972583,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.483802795410156,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.826991831505065,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07527898997068405,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04022420942783356,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013749555218964815,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.6064385175704956,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.055648285895586014,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.25491714477539,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.49364471435547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.475230980439314,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.969558715820312,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.19402659477551,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08007025718688965,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.042784351855516434,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 9.0784378699027e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014169076457619667,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.7209057807922363,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0577847957611084,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.195581436157227,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.41390228271484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.383988696488696,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.631699562072754,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.505742767315933,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09843271225690842,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05259605497121811,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017793952720239758,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.466625690460205,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05012230575084686,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.558387756347656,
      "model/normalizer/grad_frac": 0.3541601598262787,
      "model/normalizer/grad_norm": 0.1892402172088623,
      "model/normalizer/grad_zero_frac": 0.000126446015201509,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002423707628622651,
      "model/normalizer/weight_delta": 3.128532648086548,
      "model/normalizer/weight_delta_rel": 0.04029368981719017,
      "model/normalizer/weight_norm": 78.07881164550781,
      "pose_mae_dtheta": 0.08695441484451294,
      "pose_mae_dx": 0.02981589175760746,
      "pose_mae_dy": 0.03573177754878998,
      "pose_rmse_dtheta": 0.2086230218410492,
      "pose_rmse_dx": 0.07447519898414612,
      "pose_rmse_dy": 0.10093236714601517,
      "pose_rmse_mean": 0.12801019847393036,
      "rmse_dtheta": 0.026049915701150894,
      "rmse_dx": 0.006051745731383562,
      "rmse_dy": 0.006486174184828997,
      "rmse_mean": 0.012862611562013626,
      "rotation_flip": 0.00868357066065073,
      "sparse_tokens": 32201.0,
      "step": 2675,
      "turn_loss": 0.11039680242538452,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.12432633339527968,
      "grad_norm": 0.3503076136112213,
      "learning_rate": 8.901490583134087e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.02985779009759426,
      "mae_dx": 0.011651993729174137,
      "mae_dy": 0.006133051123470068,
      "pose_mae_dtheta": 0.2346309870481491,
      "pose_mae_dx": 0.09875732660293579,
      "pose_mae_dy": 0.08012942224740982,
      "pose_rmse_dtheta": 0.4071354269981384,
      "pose_rmse_dx": 0.22020210325717926,
      "pose_rmse_dy": 0.16455824673175812,
      "pose_rmse_mean": 0.2639652490615845,
      "rmse_dtheta": 0.04490312188863754,
      "rmse_dx": 0.024851150810718536,
      "rmse_dy": 0.011004222556948662,
      "rmse_mean": 0.026919499039649963,
      "rotation_flip": 0.0197554100304842,
      "sparse_tokens": 19931.0,
      "step": 2676,
      "turn_loss": 0.2832401692867279,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12437279316112247,
      "grad_norm": 0.48918652534484863,
      "learning_rate": 8.900663520640605e-06,
      "loss": 0.166,
      "mae_dtheta": 0.014711127616465092,
      "mae_dx": 0.0033982149325311184,
      "mae_dy": 0.004284929484128952,
      "pose_mae_dtheta": 0.11523354798555374,
      "pose_mae_dx": 0.038965869694948196,
      "pose_mae_dy": 0.043470919132232666,
      "pose_rmse_dtheta": 0.28531503677368164,
      "pose_rmse_dx": 0.1125117763876915,
      "pose_rmse_dy": 0.11424505710601807,
      "pose_rmse_mean": 0.1706906259059906,
      "rmse_dtheta": 0.031216830015182495,
      "rmse_dx": 0.011181462556123734,
      "rmse_dy": 0.011309061199426651,
      "rmse_mean": 0.017902452498674393,
      "rotation_flip": 0.005893909838050604,
      "sparse_tokens": 32105.0,
      "step": 2677,
      "turn_loss": 0.14502383768558502,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12441925292696525,
      "grad_norm": 0.44118183851242065,
      "learning_rate": 8.899836185371628e-06,
      "loss": 0.1085,
      "mae_dtheta": 0.011157321743667126,
      "mae_dx": 0.0025494592264294624,
      "mae_dy": 0.003117501037195325,
      "pose_mae_dtheta": 0.071174755692482,
      "pose_mae_dx": 0.027065671980381012,
      "pose_mae_dy": 0.03495104983448982,
      "pose_rmse_dtheta": 0.1352340131998062,
      "pose_rmse_dx": 0.0756831020116806,
      "pose_rmse_dy": 0.078759104013443,
      "pose_rmse_mean": 0.09655874222517014,
      "rmse_dtheta": 0.020410187542438507,
      "rmse_dx": 0.007445081602782011,
      "rmse_dy": 0.006841979455202818,
      "rmse_mean": 0.01156575046479702,
      "rotation_flip": 0.0094191525131464,
      "sparse_tokens": 32121.0,
      "step": 2678,
      "turn_loss": 0.10615278780460358,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.12446571269280803,
      "grad_norm": 0.3966023623943329,
      "learning_rate": 8.899008577385015e-06,
      "loss": 0.1175,
      "mae_dtheta": 0.01238352619111538,
      "mae_dx": 0.002816647756844759,
      "mae_dy": 0.002966661471873522,
      "pose_mae_dtheta": 0.08360712975263596,
      "pose_mae_dx": 0.026880599558353424,
      "pose_mae_dy": 0.030089709907770157,
      "pose_rmse_dtheta": 0.18056809902191162,
      "pose_rmse_dx": 0.060642920434474945,
      "pose_rmse_dy": 0.0643918365240097,
      "pose_rmse_mean": 0.10186761617660522,
      "rmse_dtheta": 0.025228822603821754,
      "rmse_dx": 0.007916702888906002,
      "rmse_dy": 0.006342496257275343,
      "rmse_mean": 0.013162674382328987,
      "rotation_flip": 0.008623442612588406,
      "sparse_tokens": 32169.0,
      "step": 2679,
      "turn_loss": 0.11496605724096298,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32987.0,
      "epoch": 0.1245121724586508,
      "grad_norm": 0.6944144368171692,
      "learning_rate": 8.898180696738639e-06,
      "loss": 0.2215,
      "mae_dtheta": 0.03475535288453102,
      "mae_dx": 0.017136225476861,
      "mae_dy": 0.006135426461696625,
      "pose_mae_dtheta": 0.2649940550327301,
      "pose_mae_dx": 0.15281900763511658,
      "pose_mae_dy": 0.07197704166173935,
      "pose_rmse_dtheta": 0.45793330669403076,
      "pose_rmse_dx": 0.29619666934013367,
      "pose_rmse_dy": 0.14378681778907776,
      "pose_rmse_mean": 0.29930561780929565,
      "rmse_dtheta": 0.052186269313097,
      "rmse_dx": 0.030428078025579453,
      "rmse_dy": 0.010867691598832607,
      "rmse_mean": 0.031160680577158928,
      "rotation_flip": 0.015013054944574833,
      "sparse_tokens": 25410.0,
      "step": 2680,
      "turn_loss": 0.30701398849487305,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.12455863222449359,
      "grad_norm": 0.5647324919700623,
      "learning_rate": 8.897352543490396e-06,
      "loss": 0.16,
      "mae_dtheta": 0.029944036155939102,
      "mae_dx": 0.014542585238814354,
      "mae_dy": 0.004937326535582542,
      "pose_mae_dtheta": 0.2234681099653244,
      "pose_mae_dx": 0.13854147493839264,
      "pose_mae_dy": 0.061176907271146774,
      "pose_rmse_dtheta": 0.38612934947013855,
      "pose_rmse_dx": 0.31002768874168396,
      "pose_rmse_dy": 0.1596394032239914,
      "pose_rmse_mean": 0.2852655053138733,
      "rmse_dtheta": 0.04461737349629402,
      "rmse_dx": 0.02896847203373909,
      "rmse_dy": 0.010502265766263008,
      "rmse_mean": 0.028029371052980423,
      "rotation_flip": 0.027227722108364105,
      "sparse_tokens": 8098.0,
      "step": 2681,
      "turn_loss": 0.2564430832862854,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.12460509199033637,
      "grad_norm": 0.6896036863327026,
      "learning_rate": 8.896524117698195e-06,
      "loss": 0.2087,
      "mae_dtheta": 0.022166328504681587,
      "mae_dx": 0.0057131452485919,
      "mae_dy": 0.004163867328315973,
      "pose_mae_dtheta": 0.12432412803173065,
      "pose_mae_dx": 0.05776895582675934,
      "pose_mae_dy": 0.03441401571035385,
      "pose_rmse_dtheta": 0.22262221574783325,
      "pose_rmse_dx": 0.14114955067634583,
      "pose_rmse_dy": 0.06993972510099411,
      "pose_rmse_mean": 0.1445704996585846,
      "rmse_dtheta": 0.03786081075668335,
      "rmse_dx": 0.013797758147120476,
      "rmse_dy": 0.008085621520876884,
      "rmse_mean": 0.01991473138332367,
      "rotation_flip": 0.005434782709926367,
      "sparse_tokens": 4246.0,
      "step": 2682,
      "turn_loss": 0.2138851135969162,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.12465155175617915,
      "grad_norm": 0.5158320665359497,
      "learning_rate": 8.895695419419973e-06,
      "loss": 0.0848,
      "mae_dtheta": 0.00901088584214449,
      "mae_dx": 0.001613366650417447,
      "mae_dy": 0.0013381361495703459,
      "pose_mae_dtheta": 0.06234947219491005,
      "pose_mae_dx": 0.017141995951533318,
      "pose_mae_dy": 0.017768660560250282,
      "pose_rmse_dtheta": 0.19972726702690125,
      "pose_rmse_dx": 0.043420176953077316,
      "pose_rmse_dy": 0.04281165078282356,
      "pose_rmse_mean": 0.0953197032213211,
      "rmse_dtheta": 0.023951973766088486,
      "rmse_dx": 0.005332048051059246,
      "rmse_dy": 0.002887456212192774,
      "rmse_mean": 0.01072382740676403,
      "rotation_flip": 0.002091175178065896,
      "sparse_tokens": 32153.0,
      "step": 2683,
      "turn_loss": 0.06777063757181168,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.12469801152202192,
      "grad_norm": 0.48122698068618774,
      "learning_rate": 8.89486644871368e-06,
      "loss": 0.1371,
      "mae_dtheta": 0.02969452366232872,
      "mae_dx": 0.01643553376197815,
      "mae_dy": 0.0034722378477454185,
      "pose_mae_dtheta": 0.20543736219406128,
      "pose_mae_dx": 0.13324254751205444,
      "pose_mae_dy": 0.043479517102241516,
      "pose_rmse_dtheta": 0.3488330543041229,
      "pose_rmse_dx": 0.27729353308677673,
      "pose_rmse_dy": 0.08015838265419006,
      "pose_rmse_mean": 0.2354283332824707,
      "rmse_dtheta": 0.042983319610357285,
      "rmse_dx": 0.03024107962846756,
      "rmse_dy": 0.00604201527312398,
      "rmse_mean": 0.02642213925719261,
      "rotation_flip": 0.0173611119389534,
      "sparse_tokens": 4947.0,
      "step": 2684,
      "turn_loss": 0.21290718019008636,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 34930.0,
      "epoch": 0.12474447128786471,
      "grad_norm": 1.159345269203186,
      "learning_rate": 8.894037205637283e-06,
      "loss": 0.3189,
      "mae_dtheta": 0.039602264761924744,
      "mae_dx": 0.01539620477706194,
      "mae_dy": 0.005036790855228901,
      "pose_mae_dtheta": 0.33813709020614624,
      "pose_mae_dx": 0.12254580855369568,
      "pose_mae_dy": 0.056528639048337936,
      "pose_rmse_dtheta": 0.5450213551521301,
      "pose_rmse_dx": 0.2635558843612671,
      "pose_rmse_dy": 0.13029596209526062,
      "pose_rmse_mean": 0.3129577338695526,
      "rmse_dtheta": 0.05630892887711525,
      "rmse_dx": 0.02862594649195671,
      "rmse_dy": 0.010481626726686954,
      "rmse_mean": 0.03180550038814545,
      "rotation_flip": 0.013439218513667583,
      "sparse_tokens": 25303.0,
      "step": 2685,
      "turn_loss": 0.34383624792099,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.12479093105370749,
      "grad_norm": 0.6825572848320007,
      "learning_rate": 8.893207690248776e-06,
      "loss": 0.1887,
      "mae_dtheta": 0.03245330601930618,
      "mae_dx": 0.008720127865672112,
      "mae_dy": 0.007255789823830128,
      "pose_mae_dtheta": 0.2234407365322113,
      "pose_mae_dx": 0.08742865920066833,
      "pose_mae_dy": 0.08542496711015701,
      "pose_rmse_dtheta": 0.42724326252937317,
      "pose_rmse_dx": 0.18890531361103058,
      "pose_rmse_dy": 0.19106100499629974,
      "pose_rmse_mean": 0.2690698802471161,
      "rmse_dtheta": 0.05106184631586075,
      "rmse_dx": 0.019687922671437263,
      "rmse_dy": 0.013851702213287354,
      "rmse_mean": 0.028200490400195122,
      "rotation_flip": 0.019298246130347252,
      "sparse_tokens": 12361.0,
      "step": 2686,
      "turn_loss": 0.280481219291687,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.12483739081955027,
      "grad_norm": 0.492512047290802,
      "learning_rate": 8.892377902606166e-06,
      "loss": 0.136,
      "mae_dtheta": 0.014110700227320194,
      "mae_dx": 0.0032667017076164484,
      "mae_dy": 0.0033901315182447433,
      "pose_mae_dtheta": 0.1050170287489891,
      "pose_mae_dx": 0.031142933294177055,
      "pose_mae_dy": 0.029747581109404564,
      "pose_rmse_dtheta": 0.2976454198360443,
      "pose_rmse_dx": 0.09122833609580994,
      "pose_rmse_dy": 0.09212223440408707,
      "pose_rmse_mean": 0.16033199429512024,
      "rmse_dtheta": 0.033503349870443344,
      "rmse_dx": 0.009166642092168331,
      "rmse_dy": 0.009478708729147911,
      "rmse_mean": 0.017382901161909103,
      "rotation_flip": 0.007930214516818523,
      "sparse_tokens": 32169.0,
      "step": 2687,
      "turn_loss": 0.12924785912036896,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.12488385058539304,
      "grad_norm": 0.5446045994758606,
      "learning_rate": 8.891547842767479e-06,
      "loss": 0.1654,
      "mae_dtheta": 0.0097828209400177,
      "mae_dx": 0.0022423691116273403,
      "mae_dy": 0.00221962109208107,
      "pose_mae_dtheta": 0.06678006052970886,
      "pose_mae_dx": 0.026072969660162926,
      "pose_mae_dy": 0.027157137170433998,
      "pose_rmse_dtheta": 0.1607571244239807,
      "pose_rmse_dx": 0.07180566340684891,
      "pose_rmse_dy": 0.0672682598233223,
      "pose_rmse_mean": 0.09994368255138397,
      "rmse_dtheta": 0.0213830154389143,
      "rmse_dx": 0.006828319281339645,
      "rmse_dy": 0.005628620740026236,
      "rmse_mean": 0.011279985308647156,
      "rotation_flip": 0.005534269846975803,
      "sparse_tokens": 32137.0,
      "step": 2688,
      "turn_loss": 0.07900349050760269,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34388.0,
      "epoch": 0.12493031035123583,
      "grad_norm": 0.7161601781845093,
      "learning_rate": 8.890717510790763e-06,
      "loss": 0.1794,
      "mae_dtheta": 0.034745268523693085,
      "mae_dx": 0.011519868858158588,
      "mae_dy": 0.003165627596899867,
      "pose_mae_dtheta": 0.2660580575466156,
      "pose_mae_dx": 0.08475249260663986,
      "pose_mae_dy": 0.030942700803279877,
      "pose_rmse_dtheta": 0.5159345269203186,
      "pose_rmse_dx": 0.1966748684644699,
      "pose_rmse_dy": 0.07509983330965042,
      "pose_rmse_mean": 0.26256975531578064,
      "rmse_dtheta": 0.05477011948823929,
      "rmse_dx": 0.023000964894890785,
      "rmse_dy": 0.007123587187379599,
      "rmse_mean": 0.02829822525382042,
      "rotation_flip": 0.012907608412206173,
      "sparse_tokens": 27946.0,
      "step": 2689,
      "turn_loss": 0.24247151613235474,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12497677011707861,
      "grad_norm": 0.8745078444480896,
      "learning_rate": 8.889886906734084e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.01153094694018364,
      "mae_dx": 0.003136260900646448,
      "mae_dy": 0.0027416329830884933,
      "pose_mae_dtheta": 0.0786621943116188,
      "pose_mae_dx": 0.03409580886363983,
      "pose_mae_dy": 0.02931012213230133,
      "pose_rmse_dtheta": 0.20148076117038727,
      "pose_rmse_dx": 0.09234415739774704,
      "pose_rmse_dy": 0.08395091444253922,
      "pose_rmse_mean": 0.12592527270317078,
      "rmse_dtheta": 0.02700778841972351,
      "rmse_dx": 0.009747602045536041,
      "rmse_dy": 0.008194093592464924,
      "rmse_mean": 0.014983161352574825,
      "rotation_flip": 0.00916963815689087,
      "sparse_tokens": 32089.0,
      "step": 2690,
      "turn_loss": 0.12125113606452942,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.1250232298829214,
      "grad_norm": 1.3469524383544922,
      "learning_rate": 8.889056030655526e-06,
      "loss": 0.2564,
      "mae_dtheta": 0.04703867435455322,
      "mae_dx": 0.011358261108398438,
      "mae_dy": 0.004531947895884514,
      "pose_mae_dtheta": 0.40635624527931213,
      "pose_mae_dx": 0.08825450390577316,
      "pose_mae_dy": 0.043779000639915466,
      "pose_rmse_dtheta": 0.7185837626457214,
      "pose_rmse_dx": 0.2034216672182083,
      "pose_rmse_dy": 0.11701364815235138,
      "pose_rmse_mean": 0.34633970260620117,
      "rmse_dtheta": 0.0695766806602478,
      "rmse_dx": 0.023344887420535088,
      "rmse_dy": 0.010535630397498608,
      "rmse_mean": 0.03448573499917984,
      "rotation_flip": 0.013434088788926601,
      "sparse_tokens": 18777.0,
      "step": 2691,
      "turn_loss": 0.2935183346271515,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12506968964876417,
      "grad_norm": 0.5408042669296265,
      "learning_rate": 8.88822488261319e-06,
      "loss": 0.1303,
      "mae_dtheta": 0.012585137039422989,
      "mae_dx": 0.0024372071493417025,
      "mae_dy": 0.0028701662085950375,
      "pose_mae_dtheta": 0.09196840226650238,
      "pose_mae_dx": 0.032177433371543884,
      "pose_mae_dy": 0.03602556511759758,
      "pose_rmse_dtheta": 0.19084900617599487,
      "pose_rmse_dx": 0.07485733926296234,
      "pose_rmse_dy": 0.08078606426715851,
      "pose_rmse_mean": 0.11549746990203857,
      "rmse_dtheta": 0.024082373827695847,
      "rmse_dx": 0.006435167510062456,
      "rmse_dy": 0.005528002977371216,
      "rmse_mean": 0.012015181593596935,
      "rotation_flip": 0.0058519793674349785,
      "sparse_tokens": 32121.0,
      "step": 2692,
      "turn_loss": 0.10786116868257523,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.12511614941460694,
      "grad_norm": 1.0308220386505127,
      "learning_rate": 8.887393462665203e-06,
      "loss": 0.1543,
      "mae_dtheta": 0.006930424831807613,
      "mae_dx": 0.0020314862485975027,
      "mae_dy": 0.0010817485162988305,
      "pose_mae_dtheta": 0.05147121101617813,
      "pose_mae_dx": 0.017531709745526314,
      "pose_mae_dy": 0.014416486956179142,
      "pose_rmse_dtheta": 0.162272647023201,
      "pose_rmse_dx": 0.055838342756032944,
      "pose_rmse_dy": 0.04089813679456711,
      "pose_rmse_mean": 0.08633637428283691,
      "rmse_dtheta": 0.021865101531147957,
      "rmse_dx": 0.006297234911471605,
      "rmse_dy": 0.00355722033418715,
      "rmse_mean": 0.010573185980319977,
      "rotation_flip": 0.00466562993824482,
      "sparse_tokens": 32153.0,
      "step": 2693,
      "turn_loss": 0.06449589878320694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.12516260918044972,
      "grad_norm": 0.4074631929397583,
      "learning_rate": 8.886561770869705e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.044148195534944534,
      "mae_dx": 0.012308841571211815,
      "mae_dy": 0.008664024993777275,
      "pose_mae_dtheta": 0.33694887161254883,
      "pose_mae_dx": 0.08450329303741455,
      "pose_mae_dy": 0.10193833708763123,
      "pose_rmse_dtheta": 0.5834869742393494,
      "pose_rmse_dx": 0.18448622524738312,
      "pose_rmse_dy": 0.22816318273544312,
      "pose_rmse_mean": 0.33204546570777893,
      "rmse_dtheta": 0.06274107843637466,
      "rmse_dx": 0.024282008409500122,
      "rmse_dy": 0.01728496514260769,
      "rmse_mean": 0.03476935252547264,
      "rotation_flip": 0.011111111380159855,
      "sparse_tokens": 14344.0,
      "step": 2694,
      "turn_loss": 0.36845698952674866,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.12520906894629252,
      "grad_norm": 0.510585606098175,
      "learning_rate": 8.885729807284855e-06,
      "loss": 0.1006,
      "mae_dtheta": 0.022802801802754402,
      "mae_dx": 0.010686207562685013,
      "mae_dy": 0.0024456914979964495,
      "pose_mae_dtheta": 0.18382611870765686,
      "pose_mae_dx": 0.07693036645650864,
      "pose_mae_dy": 0.022248737514019012,
      "pose_rmse_dtheta": 0.40582939982414246,
      "pose_rmse_dx": 0.18924567103385925,
      "pose_rmse_dy": 0.07553699612617493,
      "pose_rmse_mean": 0.2235373705625534,
      "rmse_dtheta": 0.0438787005841732,
      "rmse_dx": 0.023036882281303406,
      "rmse_dy": 0.006087874993681908,
      "rmse_mean": 0.024334488436579704,
      "rotation_flip": 0.007177033461630344,
      "sparse_tokens": 8826.0,
      "step": 2695,
      "turn_loss": 0.1116214245557785,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.1252555287121353,
      "grad_norm": 0.6859740018844604,
      "learning_rate": 8.884897571968835e-06,
      "loss": 0.1419,
      "mae_dtheta": 0.043872661888599396,
      "mae_dx": 0.012495463714003563,
      "mae_dy": 0.008657230995595455,
      "pose_mae_dtheta": 0.3604370057582855,
      "pose_mae_dx": 0.09716887027025223,
      "pose_mae_dy": 0.08456285297870636,
      "pose_rmse_dtheta": 0.6438905596733093,
      "pose_rmse_dx": 0.2059335857629776,
      "pose_rmse_dy": 0.17179396748542786,
      "pose_rmse_mean": 0.3405393958091736,
      "rmse_dtheta": 0.06387349963188171,
      "rmse_dx": 0.025334570556879044,
      "rmse_dy": 0.017137540504336357,
      "rmse_mean": 0.03544853627681732,
      "rotation_flip": 0.009463722817599773,
      "sparse_tokens": 10163.0,
      "step": 2696,
      "turn_loss": 0.31196749210357666,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.12530198847797808,
      "grad_norm": 0.5224480628967285,
      "learning_rate": 8.884065064979842e-06,
      "loss": 0.1165,
      "mae_dtheta": 0.03412972018122673,
      "mae_dx": 0.009108026511967182,
      "mae_dy": 0.004223308991640806,
      "pose_mae_dtheta": 0.30733606219291687,
      "pose_mae_dx": 0.06133919581770897,
      "pose_mae_dy": 0.051064662635326385,
      "pose_rmse_dtheta": 0.5378948450088501,
      "pose_rmse_dx": 0.1387878954410553,
      "pose_rmse_dy": 0.11050265282392502,
      "pose_rmse_mean": 0.26239514350891113,
      "rmse_dtheta": 0.05264023318886757,
      "rmse_dx": 0.019507046788930893,
      "rmse_dy": 0.008172260597348213,
      "rmse_mean": 0.026773180812597275,
      "rotation_flip": 0.01300812978297472,
      "sparse_tokens": 9366.0,
      "step": 2697,
      "turn_loss": 0.3022608160972595,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.12534844824382085,
      "grad_norm": 0.63763028383255,
      "learning_rate": 8.883232286376094e-06,
      "loss": 0.1617,
      "mae_dtheta": 0.028090381994843483,
      "mae_dx": 0.011703995987772942,
      "mae_dy": 0.0047092498280107975,
      "pose_mae_dtheta": 0.23009978234767914,
      "pose_mae_dx": 0.10901027172803879,
      "pose_mae_dy": 0.07582444697618484,
      "pose_rmse_dtheta": 0.39676371216773987,
      "pose_rmse_dx": 0.246700257062912,
      "pose_rmse_dy": 0.16301703453063965,
      "pose_rmse_mean": 0.26882702112197876,
      "rmse_dtheta": 0.042353879660367966,
      "rmse_dx": 0.024194177240133286,
      "rmse_dy": 0.008554245345294476,
      "rmse_mean": 0.025034099817276,
      "rotation_flip": 0.0027777778450399637,
      "sparse_tokens": 6353.0,
      "step": 2698,
      "turn_loss": 0.23248586058616638,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.12539490800966363,
      "grad_norm": 0.4788575768470764,
      "learning_rate": 8.882399236215829e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.010152306407690048,
      "mae_dx": 0.0016957649495452642,
      "mae_dy": 0.0025630563031882048,
      "pose_mae_dtheta": 0.07617759704589844,
      "pose_mae_dx": 0.024395909160375595,
      "pose_mae_dy": 0.03405418619513512,
      "pose_rmse_dtheta": 0.18568941950798035,
      "pose_rmse_dx": 0.07100744545459747,
      "pose_rmse_dy": 0.08237610012292862,
      "pose_rmse_mean": 0.11302432417869568,
      "rmse_dtheta": 0.022239595651626587,
      "rmse_dx": 0.005155940540134907,
      "rmse_dy": 0.005670269951224327,
      "rmse_mean": 0.011021934449672699,
      "rotation_flip": 0.004799301736056805,
      "sparse_tokens": 32041.0,
      "step": 2699,
      "turn_loss": 0.07822468131780624,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.1254413677755064,
      "grad_norm": 0.8083218932151794,
      "learning_rate": 8.881565914557302e-06,
      "loss": 0.1587,
      "mae_dtheta": 0.0352683924138546,
      "mae_dx": 0.009684508666396141,
      "mae_dy": 0.0058200424537062645,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8083217144012451,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 149.21331787109375,
      "model/head/act_norm_mean": 107.39373016357422,
      "model/head/act_norm_min": 63.1998291015625,
      "model/head/act_over_embed": 73.8019768043509,
      "model/head/grad_frac": 0.0929405614733696,
      "model/head/grad_norm": 0.07512587308883667,
      "model/head/grad_zero_frac": 0.0001700576685834676,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6834716796875,
      "model/head/update_ratio": 0.0012983630876988173,
      "model/head/weight_delta": 6.057643413543701,
      "model/head/weight_delta_rel": 0.10626900941133499,
      "model/head/weight_norm": 57.86199188232422,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41542714834213257,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41538495728463837,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41534221172332764,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2854564315412441,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09807773679494858,
      "model/modality_embedder.encoders.pose/grad_norm": 0.079278364777565,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5409564393939394,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002573776990175247,
      "model/modality_embedder.encoders.pose/weight_delta": 1.9886938333511353,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06497682631015778,
      "model/modality_embedder.encoders.pose/weight_norm": 30.802343368530273,
      "model/modality_embedder/grad_frac": 0.09807773679494858,
      "model/modality_embedder/grad_norm": 0.079278364777565,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5409564393939394,
      "model/modality_embedder/update_ratio": 0.002573776990175247,
      "model/modality_embedder/weight_delta": 1.9886938333511353,
      "model/modality_embedder/weight_delta_rel": 0.06497682631015778,
      "model/modality_embedder/weight_norm": 30.802343368530273,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.18244934082031,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.282391260540674,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.172250747680664,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.999877247424756,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08862119913101196,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.071634441614151,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002589866751804948,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.2934513092041016,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.047134146094322205,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.659507751464844,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.83309173583984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.16177222842262,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.570741653442383,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.60419608144756,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07959283143281937,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0643366128206253,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002198881469666958,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.6198269128799438,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05611206963658333,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.258790969848633,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 76.35987854003906,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.876522972470237,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.777592658996582,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.78258884650648,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07372218370437622,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05959124118089676,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019732587970793247,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.7354975938796997,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0582747608423233,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.199405670166016,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.56600189208984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.836600167410715,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.961137771606445,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.129572245401395,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07543537765741348,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0609760507941246,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020626825280487537,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.4783411026000977,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.050522685050964355,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.5615291595459,
      "model/normalizer/grad_frac": 0.30001717805862427,
      "model/normalizer/grad_norm": 0.24251040816307068,
      "model/normalizer/grad_zero_frac": 0.0001949868310475722,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0031058003660291433,
      "model/normalizer/weight_delta": 3.154350757598877,
      "model/normalizer/weight_delta_rel": 0.04062621295452118,
      "model/normalizer/weight_norm": 78.08306121826172,
      "pose_mae_dtheta": 0.2797050178050995,
      "pose_mae_dx": 0.06239697337150574,
      "pose_mae_dy": 0.0696730762720108,
      "pose_rmse_dtheta": 0.4973924160003662,
      "pose_rmse_dx": 0.1322542428970337,
      "pose_rmse_dy": 0.1874004602432251,
      "pose_rmse_mean": 0.2723490595817566,
      "rmse_dtheta": 0.05415808781981468,
      "rmse_dx": 0.020034298300743103,
      "rmse_dy": 0.014351451769471169,
      "rmse_mean": 0.0295146144926548,
      "rotation_flip": 0.013806706294417381,
      "sparse_tokens": 8245.0,
      "step": 2700,
      "turn_loss": 0.22225350141525269,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.12548782754134918,
      "grad_norm": 0.6223134398460388,
      "learning_rate": 8.880732321458785e-06,
      "loss": 0.0767,
      "mae_dtheta": 0.007392368745058775,
      "mae_dx": 0.0013022531056776643,
      "mae_dy": 0.0005188153591006994,
      "pose_mae_dtheta": 0.052404869347810745,
      "pose_mae_dx": 0.010398930869996548,
      "pose_mae_dy": 0.00709253316745162,
      "pose_rmse_dtheta": 0.23163411021232605,
      "pose_rmse_dx": 0.02693093568086624,
      "pose_rmse_dy": 0.016054382547736168,
      "pose_rmse_mean": 0.09153981506824493,
      "rmse_dtheta": 0.026996400207281113,
      "rmse_dx": 0.003991700243204832,
      "rmse_dy": 0.0012912345118820667,
      "rmse_mean": 0.010759778320789337,
      "rotation_flip": 0.001626898068934679,
      "sparse_tokens": 32185.0,
      "step": 2701,
      "turn_loss": 0.04039812833070755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12553428730719196,
      "grad_norm": 0.6376620531082153,
      "learning_rate": 8.879898456978575e-06,
      "loss": 0.2393,
      "mae_dtheta": 0.014722217805683613,
      "mae_dx": 0.003576233983039856,
      "mae_dy": 0.004215074237436056,
      "pose_mae_dtheta": 0.10720012336969376,
      "pose_mae_dx": 0.04191190376877785,
      "pose_mae_dy": 0.048359841108322144,
      "pose_rmse_dtheta": 0.25555694103240967,
      "pose_rmse_dx": 0.12667468190193176,
      "pose_rmse_dy": 0.14321108162403107,
      "pose_rmse_mean": 0.17514757812023163,
      "rmse_dtheta": 0.030649680644273758,
      "rmse_dx": 0.011416715569794178,
      "rmse_dy": 0.010413247160613537,
      "rmse_mean": 0.017493214458227158,
      "rotation_flip": 0.006773920264095068,
      "sparse_tokens": 32073.0,
      "step": 2702,
      "turn_loss": 0.13619950413703918,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.12558074707303477,
      "grad_norm": 0.48673373460769653,
      "learning_rate": 8.879064321174984e-06,
      "loss": 0.1137,
      "mae_dtheta": 0.021346041932702065,
      "mae_dx": 0.00598930986598134,
      "mae_dy": 0.005124561954289675,
      "pose_mae_dtheta": 0.17080095410346985,
      "pose_mae_dx": 0.048529498279094696,
      "pose_mae_dy": 0.06842467188835144,
      "pose_rmse_dtheta": 0.28636497259140015,
      "pose_rmse_dx": 0.138642355799675,
      "pose_rmse_dy": 0.141611710190773,
      "pose_rmse_mean": 0.1888730227947235,
      "rmse_dtheta": 0.03326796367764473,
      "rmse_dx": 0.0161164291203022,
      "rmse_dy": 0.008788974024355412,
      "rmse_mean": 0.019391123205423355,
      "rotation_flip": 0.01642710529267788,
      "sparse_tokens": 9502.0,
      "step": 2703,
      "turn_loss": 0.18033012747764587,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.12562720683887754,
      "grad_norm": 0.5102350115776062,
      "learning_rate": 8.878229914106342e-06,
      "loss": 0.1271,
      "mae_dtheta": 0.02904972992837429,
      "mae_dx": 0.01711367256939411,
      "mae_dy": 0.006206711754202843,
      "pose_mae_dtheta": 0.22660453617572784,
      "pose_mae_dx": 0.12089516967535019,
      "pose_mae_dy": 0.06088392436504364,
      "pose_rmse_dtheta": 0.3975437879562378,
      "pose_rmse_dx": 0.24331781268119812,
      "pose_rmse_dy": 0.15403978526592255,
      "pose_rmse_mean": 0.264967143535614,
      "rmse_dtheta": 0.04219227656722069,
      "rmse_dx": 0.029529986903071404,
      "rmse_dy": 0.013277141377329826,
      "rmse_mean": 0.028333134949207306,
      "rotation_flip": 0.012500000186264515,
      "sparse_tokens": 4919.0,
      "step": 2704,
      "turn_loss": 0.1974276751279831,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12567366660472032,
      "grad_norm": 0.39556649327278137,
      "learning_rate": 8.877395235831002e-06,
      "loss": 0.1029,
      "mae_dtheta": 0.010921982116997242,
      "mae_dx": 0.002495111897587776,
      "mae_dy": 0.0034602100495249033,
      "pose_mae_dtheta": 0.07454738020896912,
      "pose_mae_dx": 0.029899299144744873,
      "pose_mae_dy": 0.03232301026582718,
      "pose_rmse_dtheta": 0.16760993003845215,
      "pose_rmse_dx": 0.07425304502248764,
      "pose_rmse_dy": 0.07152307778596878,
      "pose_rmse_mean": 0.10446202009916306,
      "rmse_dtheta": 0.02297171950340271,
      "rmse_dx": 0.006841529626399279,
      "rmse_dy": 0.008018091320991516,
      "rmse_mean": 0.01261044666171074,
      "rotation_flip": 0.005639097653329372,
      "sparse_tokens": 32121.0,
      "step": 2705,
      "turn_loss": 0.10321853309869766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16835.0,
      "epoch": 0.1257201263705631,
      "grad_norm": 0.6694652438163757,
      "learning_rate": 8.87656028640733e-06,
      "loss": 0.1594,
      "mae_dtheta": 0.03589220717549324,
      "mae_dx": 0.011212017387151718,
      "mae_dy": 0.005516807083040476,
      "pose_mae_dtheta": 0.31563612818717957,
      "pose_mae_dx": 0.09046982228755951,
      "pose_mae_dy": 0.07287102192640305,
      "pose_rmse_dtheta": 0.5736463665962219,
      "pose_rmse_dx": 0.20089125633239746,
      "pose_rmse_dy": 0.19594243168830872,
      "pose_rmse_mean": 0.3234933614730835,
      "rmse_dtheta": 0.05665803328156471,
      "rmse_dx": 0.022783204913139343,
      "rmse_dy": 0.011829441413283348,
      "rmse_mean": 0.030423559248447418,
      "rotation_flip": 0.019975030794739723,
      "sparse_tokens": 13724.0,
      "step": 2706,
      "turn_loss": 0.29960572719573975,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 21749.0,
      "epoch": 0.12576658613640587,
      "grad_norm": 0.4998024106025696,
      "learning_rate": 8.875725065893717e-06,
      "loss": 0.13,
      "mae_dtheta": 0.023298930376768112,
      "mae_dx": 0.011593657545745373,
      "mae_dy": 0.00566799147054553,
      "pose_mae_dtheta": 0.17175179719924927,
      "pose_mae_dx": 0.08172474801540375,
      "pose_mae_dy": 0.07245641946792603,
      "pose_rmse_dtheta": 0.27824822068214417,
      "pose_rmse_dx": 0.19123809039592743,
      "pose_rmse_dy": 0.1714608520269394,
      "pose_rmse_mean": 0.21364906430244446,
      "rmse_dtheta": 0.03585188090801239,
      "rmse_dx": 0.023601822555065155,
      "rmse_dy": 0.011437434703111649,
      "rmse_mean": 0.023630380630493164,
      "rotation_flip": 0.007028112653642893,
      "sparse_tokens": 18363.0,
      "step": 2707,
      "turn_loss": 0.2195345163345337,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.12581304590224865,
      "grad_norm": 0.6843993663787842,
      "learning_rate": 8.874889574348571e-06,
      "loss": 0.1055,
      "mae_dtheta": 0.010510382242500782,
      "mae_dx": 0.0021766386926174164,
      "mae_dy": 0.0034476041328161955,
      "pose_mae_dtheta": 0.07738790661096573,
      "pose_mae_dx": 0.02786208689212799,
      "pose_mae_dy": 0.03883693739771843,
      "pose_rmse_dtheta": 0.1834256798028946,
      "pose_rmse_dx": 0.08292847871780396,
      "pose_rmse_dy": 0.13350588083267212,
      "pose_rmse_mean": 0.13328668475151062,
      "rmse_dtheta": 0.022176476195454597,
      "rmse_dx": 0.007118725683540106,
      "rmse_dy": 0.010121921077370644,
      "rmse_mean": 0.01313904207199812,
      "rotation_flip": 0.005982906091958284,
      "sparse_tokens": 32057.0,
      "step": 2708,
      "turn_loss": 0.10079604387283325,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.12585950566809143,
      "grad_norm": 0.5208126306533813,
      "learning_rate": 8.874053811830317e-06,
      "loss": 0.1377,
      "mae_dtheta": 0.012223409488797188,
      "mae_dx": 0.0024287221021950245,
      "mae_dy": 0.0028165888506919146,
      "pose_mae_dtheta": 0.0885189026594162,
      "pose_mae_dx": 0.02773161046206951,
      "pose_mae_dy": 0.03423484414815903,
      "pose_rmse_dtheta": 0.18157097697257996,
      "pose_rmse_dx": 0.06130657717585564,
      "pose_rmse_dy": 0.07087559252977371,
      "pose_rmse_mean": 0.10458438843488693,
      "rmse_dtheta": 0.025258328765630722,
      "rmse_dx": 0.006954395677894354,
      "rmse_dy": 0.0063871662132442,
      "rmse_mean": 0.012866630218923092,
      "rotation_flip": 0.004646176006644964,
      "sparse_tokens": 32169.0,
      "step": 2709,
      "turn_loss": 0.118721604347229,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.1259059654339342,
      "grad_norm": 0.6320991516113281,
      "learning_rate": 8.8732177783974e-06,
      "loss": 0.1959,
      "mae_dtheta": 0.02382529526948929,
      "mae_dx": 0.006337698549032211,
      "mae_dy": 0.004324289504438639,
      "pose_mae_dtheta": 0.18422794342041016,
      "pose_mae_dx": 0.07165447622537613,
      "pose_mae_dy": 0.06411806493997574,
      "pose_rmse_dtheta": 0.3805679380893707,
      "pose_rmse_dx": 0.18259340524673462,
      "pose_rmse_dy": 0.2001064121723175,
      "pose_rmse_mean": 0.2544226050376892,
      "rmse_dtheta": 0.04057636111974716,
      "rmse_dx": 0.01634339988231659,
      "rmse_dy": 0.01059744879603386,
      "rmse_mean": 0.022505735978484154,
      "rotation_flip": 0.012096773833036423,
      "sparse_tokens": 4312.0,
      "step": 2710,
      "turn_loss": 0.16695833206176758,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.12595242519977698,
      "grad_norm": 0.38002943992614746,
      "learning_rate": 8.872381474108284e-06,
      "loss": 0.0854,
      "mae_dtheta": 0.009468389675021172,
      "mae_dx": 0.0013459641486406326,
      "mae_dy": 0.0017176092369481921,
      "pose_mae_dtheta": 0.06350665539503098,
      "pose_mae_dx": 0.01959485374391079,
      "pose_mae_dy": 0.023738190531730652,
      "pose_rmse_dtheta": 0.16765397787094116,
      "pose_rmse_dx": 0.043791331350803375,
      "pose_rmse_dy": 0.05970834940671921,
      "pose_rmse_mean": 0.09038455784320831,
      "rmse_dtheta": 0.022229038178920746,
      "rmse_dx": 0.003720121458172798,
      "rmse_dy": 0.003752787597477436,
      "rmse_mean": 0.009900650009512901,
      "rotation_flip": 0.00206682737916708,
      "sparse_tokens": 32169.0,
      "step": 2711,
      "turn_loss": 0.0705699548125267,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12599888496561978,
      "grad_norm": 0.5876978635787964,
      "learning_rate": 8.871544899021456e-06,
      "loss": 0.0884,
      "mae_dtheta": 0.010717912577092648,
      "mae_dx": 0.0017238608561456203,
      "mae_dy": 0.0024494703393429518,
      "pose_mae_dtheta": 0.07249527424573898,
      "pose_mae_dx": 0.024374961853027344,
      "pose_mae_dy": 0.03116094321012497,
      "pose_rmse_dtheta": 0.1679375320672989,
      "pose_rmse_dx": 0.06178949400782585,
      "pose_rmse_dy": 0.08353372663259506,
      "pose_rmse_mean": 0.1044202595949173,
      "rmse_dtheta": 0.023768985643982887,
      "rmse_dx": 0.00457937503233552,
      "rmse_dy": 0.005647708661854267,
      "rmse_mean": 0.011332022957503796,
      "rotation_flip": 0.0046828435733914375,
      "sparse_tokens": 32105.0,
      "step": 2712,
      "turn_loss": 0.09356889873743057,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.12604534473146256,
      "grad_norm": 0.8772942423820496,
      "learning_rate": 8.870708053195414e-06,
      "loss": 0.1063,
      "mae_dtheta": 0.008188297972083092,
      "mae_dx": 0.0012593179708346725,
      "mae_dy": 0.0017951594199985266,
      "pose_mae_dtheta": 0.05770450085401535,
      "pose_mae_dx": 0.017943287268280983,
      "pose_mae_dy": 0.026884891092777252,
      "pose_rmse_dtheta": 0.1233474612236023,
      "pose_rmse_dx": 0.047720570117235184,
      "pose_rmse_dy": 0.06791867315769196,
      "pose_rmse_mean": 0.07966223359107971,
      "rmse_dtheta": 0.015956422314047813,
      "rmse_dx": 0.004934266675263643,
      "rmse_dy": 0.0034376829862594604,
      "rmse_mean": 0.008109457790851593,
      "rotation_flip": 0.004884005058556795,
      "sparse_tokens": 32057.0,
      "step": 2713,
      "turn_loss": 0.061847023665905,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.12609180449730534,
      "grad_norm": 1.1713712215423584,
      "learning_rate": 8.869870936688678e-06,
      "loss": 0.2812,
      "mae_dtheta": 0.03395942226052284,
      "mae_dx": 0.01225738413631916,
      "mae_dy": 0.004545820876955986,
      "pose_mae_dtheta": 0.23743143677711487,
      "pose_mae_dx": 0.10625621676445007,
      "pose_mae_dy": 0.05179484933614731,
      "pose_rmse_dtheta": 0.4590800404548645,
      "pose_rmse_dx": 0.2397407591342926,
      "pose_rmse_dy": 0.12311804294586182,
      "pose_rmse_mean": 0.27397963404655457,
      "rmse_dtheta": 0.054451197385787964,
      "rmse_dx": 0.024810710921883583,
      "rmse_dy": 0.010668459348380566,
      "rmse_mean": 0.02997678890824318,
      "rotation_flip": 0.01116071455180645,
      "sparse_tokens": 15189.0,
      "step": 2714,
      "turn_loss": 0.24800202250480652,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12613826426314811,
      "grad_norm": 0.4687963128089905,
      "learning_rate": 8.869033549559794e-06,
      "loss": 0.0966,
      "mae_dtheta": 0.012601948343217373,
      "mae_dx": 0.002376623684540391,
      "mae_dy": 0.002601279877126217,
      "pose_mae_dtheta": 0.08336832374334335,
      "pose_mae_dx": 0.024779731407761574,
      "pose_mae_dy": 0.029851054772734642,
      "pose_rmse_dtheta": 0.20741721987724304,
      "pose_rmse_dx": 0.06388088315725327,
      "pose_rmse_dy": 0.06862161308526993,
      "pose_rmse_mean": 0.11330657452344894,
      "rmse_dtheta": 0.027258852496743202,
      "rmse_dx": 0.00800037570297718,
      "rmse_dy": 0.005787310190498829,
      "rmse_mean": 0.013682179152965546,
      "rotation_flip": 0.002177858492359519,
      "sparse_tokens": 32121.0,
      "step": 2715,
      "turn_loss": 0.1169193759560585,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.1261847240289909,
      "grad_norm": 0.7801337838172913,
      "learning_rate": 8.868195891867315e-06,
      "loss": 0.1391,
      "mae_dtheta": 0.03079097531735897,
      "mae_dx": 0.012350369244813919,
      "mae_dy": 0.008631065487861633,
      "pose_mae_dtheta": 0.22341498732566833,
      "pose_mae_dx": 0.0726170688867569,
      "pose_mae_dy": 0.0763002336025238,
      "pose_rmse_dtheta": 0.33680275082588196,
      "pose_rmse_dx": 0.13930347561836243,
      "pose_rmse_dy": 0.1964387148618698,
      "pose_rmse_mean": 0.2241816520690918,
      "rmse_dtheta": 0.04317118227481842,
      "rmse_dx": 0.02501973882317543,
      "rmse_dy": 0.016440263018012047,
      "rmse_mean": 0.028210394084453583,
      "rotation_flip": 0.003952569328248501,
      "sparse_tokens": 3745.0,
      "step": 2716,
      "turn_loss": 0.3078859746456146,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.12623118379483367,
      "grad_norm": 0.8449338674545288,
      "learning_rate": 8.867357963669821e-06,
      "loss": 0.1672,
      "mae_dtheta": 0.037026092410087585,
      "mae_dx": 0.010744567960500717,
      "mae_dy": 0.005979480687528849,
      "pose_mae_dtheta": 0.27060145139694214,
      "pose_mae_dx": 0.10386127978563309,
      "pose_mae_dy": 0.0730641782283783,
      "pose_rmse_dtheta": 0.5234823822975159,
      "pose_rmse_dx": 0.22926823794841766,
      "pose_rmse_dy": 0.18433713912963867,
      "pose_rmse_mean": 0.3123626112937927,
      "rmse_dtheta": 0.05586164817214012,
      "rmse_dx": 0.023211747407913208,
      "rmse_dy": 0.012845863588154316,
      "rmse_mean": 0.030639756470918655,
      "rotation_flip": 0.006830601021647453,
      "sparse_tokens": 12752.0,
      "step": 2717,
      "turn_loss": 0.24960917234420776,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 34713.0,
      "epoch": 0.12627764356067644,
      "grad_norm": 0.535027027130127,
      "learning_rate": 8.86651976502591e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.029803216457366943,
      "mae_dx": 0.009637442417442799,
      "mae_dy": 0.004291104152798653,
      "pose_mae_dtheta": 0.2390473484992981,
      "pose_mae_dx": 0.07957520335912704,
      "pose_mae_dy": 0.043664515018463135,
      "pose_rmse_dtheta": 0.4226062595844269,
      "pose_rmse_dx": 0.19426757097244263,
      "pose_rmse_dy": 0.10765598714351654,
      "pose_rmse_mean": 0.24150995910167694,
      "rmse_dtheta": 0.04704227298498154,
      "rmse_dx": 0.021511292085051537,
      "rmse_dy": 0.008565718308091164,
      "rmse_mean": 0.025706429034471512,
      "rotation_flip": 0.009463722817599773,
      "sparse_tokens": 26347.0,
      "step": 2718,
      "turn_loss": 0.23740030825138092,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.12632410332651922,
      "grad_norm": 0.6320157051086426,
      "learning_rate": 8.865681295994195e-06,
      "loss": 0.089,
      "mae_dtheta": 0.024994293227791786,
      "mae_dx": 0.00608539255335927,
      "mae_dy": 0.0026710843667387962,
      "pose_mae_dtheta": 0.1986362338066101,
      "pose_mae_dx": 0.05099499970674515,
      "pose_mae_dy": 0.04336632043123245,
      "pose_rmse_dtheta": 0.4003816843032837,
      "pose_rmse_dx": 0.1348266452550888,
      "pose_rmse_dy": 0.11476870626211166,
      "pose_rmse_mean": 0.21665900945663452,
      "rmse_dtheta": 0.04509185254573822,
      "rmse_dx": 0.015691332519054413,
      "rmse_dy": 0.005417176056653261,
      "rmse_mean": 0.022066786885261536,
      "rotation_flip": 0.01425178162753582,
      "sparse_tokens": 10038.0,
      "step": 2719,
      "turn_loss": 0.15545779466629028,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12637056309236203,
      "grad_norm": 0.5304231643676758,
      "learning_rate": 8.864842556633312e-06,
      "loss": 0.1015,
      "mae_dtheta": 0.01375332847237587,
      "mae_dx": 0.0033038000110536814,
      "mae_dy": 0.002543587936088443,
      "pose_mae_dtheta": 0.10407056659460068,
      "pose_mae_dx": 0.03411979228258133,
      "pose_mae_dy": 0.036595817655324936,
      "pose_rmse_dtheta": 0.2734648287296295,
      "pose_rmse_dx": 0.10678065568208694,
      "pose_rmse_dy": 0.09790025651454926,
      "pose_rmse_mean": 0.1593819111585617,
      "rmse_dtheta": 0.030617285519838333,
      "rmse_dx": 0.011468356475234032,
      "rmse_dy": 0.006176244933158159,
      "rmse_mean": 0.01608729548752308,
      "rotation_flip": 0.003913043532520533,
      "sparse_tokens": 32073.0,
      "step": 2720,
      "turn_loss": 0.11413269490003586,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14898.0,
      "epoch": 0.1264170228582048,
      "grad_norm": 0.6278727054595947,
      "learning_rate": 8.864003547001916e-06,
      "loss": 0.159,
      "mae_dtheta": 0.0278024785220623,
      "mae_dx": 0.010556467808783054,
      "mae_dy": 0.005481473170220852,
      "pose_mae_dtheta": 0.23485878109931946,
      "pose_mae_dx": 0.10049500316381454,
      "pose_mae_dy": 0.07476594299077988,
      "pose_rmse_dtheta": 0.43804872035980225,
      "pose_rmse_dx": 0.23994719982147217,
      "pose_rmse_dy": 0.16710875928401947,
      "pose_rmse_mean": 0.28170156478881836,
      "rmse_dtheta": 0.0450640507042408,
      "rmse_dx": 0.023291634395718575,
      "rmse_dy": 0.009797606617212296,
      "rmse_mean": 0.026051100343465805,
      "rotation_flip": 0.0017985611921176314,
      "sparse_tokens": 10578.0,
      "step": 2721,
      "turn_loss": 0.2407882958650589,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.12646348262404758,
      "grad_norm": 0.5540719032287598,
      "learning_rate": 8.863164267158677e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.011794284917414188,
      "mae_dx": 0.00244060973636806,
      "mae_dy": 0.00266540446318686,
      "pose_mae_dtheta": 0.08268909901380539,
      "pose_mae_dx": 0.028029579669237137,
      "pose_mae_dy": 0.027136079967021942,
      "pose_rmse_dtheta": 0.2007916420698166,
      "pose_rmse_dx": 0.06785286962985992,
      "pose_rmse_dy": 0.05977681651711464,
      "pose_rmse_mean": 0.10947377979755402,
      "rmse_dtheta": 0.024632027372717857,
      "rmse_dx": 0.0069715105928480625,
      "rmse_dy": 0.006307187490165234,
      "rmse_mean": 0.012636909261345863,
      "rotation_flip": 0.0018975331913679838,
      "sparse_tokens": 32137.0,
      "step": 2722,
      "turn_loss": 0.1012006625533104,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12650994238989036,
      "grad_norm": 0.5575402975082397,
      "learning_rate": 8.86232471716229e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.01304211001843214,
      "mae_dx": 0.0026389898266643286,
      "mae_dy": 0.0028684299904853106,
      "pose_mae_dtheta": 0.09073395282030106,
      "pose_mae_dx": 0.03167612478137016,
      "pose_mae_dy": 0.0341372974216938,
      "pose_rmse_dtheta": 0.20896321535110474,
      "pose_rmse_dx": 0.08396075665950775,
      "pose_rmse_dy": 0.07430829107761383,
      "pose_rmse_mean": 0.12241075932979584,
      "rmse_dtheta": 0.026530703529715538,
      "rmse_dx": 0.008277306333184242,
      "rmse_dy": 0.006624809931963682,
      "rmse_mean": 0.013810940086841583,
      "rotation_flip": 0.006021677982062101,
      "sparse_tokens": 32105.0,
      "step": 2723,
      "turn_loss": 0.10230974107980728,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.12655640215573313,
      "grad_norm": 0.4976789951324463,
      "learning_rate": 8.86148489707146e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.026039840653538704,
      "mae_dx": 0.010592653416097164,
      "mae_dy": 0.005790567956864834,
      "pose_mae_dtheta": 0.1855766624212265,
      "pose_mae_dx": 0.08477140218019485,
      "pose_mae_dy": 0.06451831012964249,
      "pose_rmse_dtheta": 0.33968305587768555,
      "pose_rmse_dx": 0.1730489581823349,
      "pose_rmse_dy": 0.15017734467983246,
      "pose_rmse_mean": 0.2209697961807251,
      "rmse_dtheta": 0.04269550368189812,
      "rmse_dx": 0.022289149463176727,
      "rmse_dy": 0.011532779783010483,
      "rmse_mean": 0.025505810976028442,
      "rotation_flip": 0.017035774886608124,
      "sparse_tokens": 10094.0,
      "step": 2724,
      "turn_loss": 0.1894058883190155,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.1266028619215759,
      "grad_norm": 1.1004407405853271,
      "learning_rate": 8.860644806944917e-06,
      "loss": 0.2312,
      "mae_dtheta": 0.025554688647389412,
      "mae_dx": 0.010455162264406681,
      "mae_dy": 0.005149586591869593,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999994039535522,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.47959899902344,
      "model/head/act_norm_mean": 109.24070785984848,
      "model/head/act_norm_min": 53.59181213378906,
      "model/head/act_over_embed": 75.0712371689082,
      "model/head/grad_frac": 0.1008724644780159,
      "model/head/grad_norm": 0.10087240487337112,
      "model/head/grad_zero_frac": 0.00011294875002931803,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6793027935606061,
      "model/head/update_ratio": 0.0017430877778679132,
      "model/head/weight_delta": 6.090679168701172,
      "model/head/weight_delta_rel": 0.10684855282306671,
      "model/head/weight_norm": 57.86995315551758,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41549068689346313,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4154318055110191,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41535505652427673,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.285488626081013,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07530172914266586,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07530168443918228,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.529413479477612,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0024445049930363894,
      "model/modality_embedder.encoders.pose/weight_delta": 2.003953456878662,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06547540426254272,
      "model/modality_embedder.encoders.pose/weight_norm": 30.80447006225586,
      "model/modality_embedder/grad_frac": 0.07530172914266586,
      "model/modality_embedder/grad_norm": 0.07530168443918228,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.529413479477612,
      "model/modality_embedder/update_ratio": 0.0024445049930363894,
      "model/modality_embedder/weight_delta": 2.003953456878662,
      "model/modality_embedder/weight_delta_rel": 0.06547540426254272,
      "model/modality_embedder/weight_norm": 30.80447006225586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.89374542236328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.39401267135642,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.092334747314453,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.07658452595345,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11797338724136353,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.11797332018613815,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.004264842718839645,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.3041414022445679,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04752369970083237,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.661821365356445,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.20990753173828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.33615921115921,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.607070922851562,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.7240364486208,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09955725073814392,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.09955719113349915,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.003402160480618477,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.6326130628585815,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.056554991751909256,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.26293182373047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.9139175415039,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.098781715969217,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.110791206359863,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.93532713585812,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.099005788564682,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.09900572896003723,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.003278015647083521,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.7486331462860107,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0587158277630806,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.202945709228516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.39590454101562,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.020536465848966,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.672831535339355,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.255974991726916,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08781857043504715,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08781851828098297,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 8.574080129619688e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002970437053591013,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.4898462295532227,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05091587454080582,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.56417465209961,
      "model/normalizer/grad_frac": 0.35564884543418884,
      "model/normalizer/grad_norm": 0.35564863681793213,
      "model/normalizer/grad_zero_frac": 0.00010162950638914481,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004554504994302988,
      "model/normalizer/weight_delta": 3.1790010929107666,
      "model/normalizer/weight_delta_rel": 0.040943693369627,
      "model/normalizer/weight_norm": 78.08721923828125,
      "pose_mae_dtheta": 0.18848177790641785,
      "pose_mae_dx": 0.08855999261140823,
      "pose_mae_dy": 0.06653515994548798,
      "pose_rmse_dtheta": 0.3497656285762787,
      "pose_rmse_dx": 0.20528577268123627,
      "pose_rmse_dy": 0.15673305094242096,
      "pose_rmse_mean": 0.23726147413253784,
      "rmse_dtheta": 0.04279495030641556,
      "rmse_dx": 0.023271886631846428,
      "rmse_dy": 0.010532200336456299,
      "rmse_mean": 0.02553301304578781,
      "rotation_flip": 0.012987012974917889,
      "sparse_tokens": 16234.0,
      "step": 2725,
      "turn_loss": 0.18015876412391663,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.1266493216874187,
      "grad_norm": 0.7626641988754272,
      "learning_rate": 8.859804446841413e-06,
      "loss": 0.1798,
      "mae_dtheta": 0.029105981811881065,
      "mae_dx": 0.011424523778259754,
      "mae_dy": 0.006317928433418274,
      "pose_mae_dtheta": 0.19312655925750732,
      "pose_mae_dx": 0.08413606137037277,
      "pose_mae_dy": 0.07768178731203079,
      "pose_rmse_dtheta": 0.3422169089317322,
      "pose_rmse_dx": 0.20625029504299164,
      "pose_rmse_dy": 0.16421154141426086,
      "pose_rmse_mean": 0.23755960166454315,
      "rmse_dtheta": 0.044447820633649826,
      "rmse_dx": 0.024382151663303375,
      "rmse_dy": 0.011658092960715294,
      "rmse_mean": 0.026829354465007782,
      "rotation_flip": 0.010906040668487549,
      "sparse_tokens": 20688.0,
      "step": 2726,
      "turn_loss": 0.29058629274368286,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12669578145326146,
      "grad_norm": 0.6403507590293884,
      "learning_rate": 8.858963816819712e-06,
      "loss": 0.1225,
      "mae_dtheta": 0.012204599566757679,
      "mae_dx": 0.00207655131816864,
      "mae_dy": 0.0026393760927021503,
      "pose_mae_dtheta": 0.08704928308725357,
      "pose_mae_dx": 0.02802875265479088,
      "pose_mae_dy": 0.03426466882228851,
      "pose_rmse_dtheta": 0.20761573314666748,
      "pose_rmse_dx": 0.06963732838630676,
      "pose_rmse_dy": 0.06851056963205338,
      "pose_rmse_mean": 0.11525454372167587,
      "rmse_dtheta": 0.024304473772644997,
      "rmse_dx": 0.006312419660389423,
      "rmse_dy": 0.005193989258259535,
      "rmse_mean": 0.01193696167320013,
      "rotation_flip": 0.005042016971856356,
      "sparse_tokens": 32121.0,
      "step": 2727,
      "turn_loss": 0.08865071088075638,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12674224121910427,
      "grad_norm": 0.40720313787460327,
      "learning_rate": 8.858122916938601e-06,
      "loss": 0.1024,
      "mae_dtheta": 0.014280440285801888,
      "mae_dx": 0.003259680001065135,
      "mae_dy": 0.0044602518901228905,
      "pose_mae_dtheta": 0.09576215595006943,
      "pose_mae_dx": 0.04308924451470375,
      "pose_mae_dy": 0.04773387685418129,
      "pose_rmse_dtheta": 0.21029752492904663,
      "pose_rmse_dx": 0.09934438765048981,
      "pose_rmse_dy": 0.1140366718173027,
      "pose_rmse_mean": 0.14122620224952698,
      "rmse_dtheta": 0.026389777660369873,
      "rmse_dx": 0.008178253658115864,
      "rmse_dy": 0.009098013862967491,
      "rmse_mean": 0.014555348083376884,
      "rotation_flip": 0.007838014513254166,
      "sparse_tokens": 32121.0,
      "step": 2728,
      "turn_loss": 0.1333795189857483,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.12678870098494704,
      "grad_norm": 0.4626728594303131,
      "learning_rate": 8.857281747256883e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.01139705628156662,
      "mae_dx": 0.0034859932493418455,
      "mae_dy": 0.0025607531424611807,
      "pose_mae_dtheta": 0.08334028720855713,
      "pose_mae_dx": 0.0374799519777298,
      "pose_mae_dy": 0.03111305646598339,
      "pose_rmse_dtheta": 0.20127840340137482,
      "pose_rmse_dx": 0.10913489758968353,
      "pose_rmse_dy": 0.0773996114730835,
      "pose_rmse_mean": 0.12927097082138062,
      "rmse_dtheta": 0.02512853965163231,
      "rmse_dx": 0.01124570146203041,
      "rmse_dy": 0.006197311915457249,
      "rmse_mean": 0.014190517365932465,
      "rotation_flip": 0.003429691307246685,
      "sparse_tokens": 32057.0,
      "step": 2729,
      "turn_loss": 0.11946914345026016,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12683516075078982,
      "grad_norm": 0.38648244738578796,
      "learning_rate": 8.85644030783338e-06,
      "loss": 0.099,
      "mae_dtheta": 0.009214320220053196,
      "mae_dx": 0.0019441519398242235,
      "mae_dy": 0.0019300786079838872,
      "pose_mae_dtheta": 0.0662488266825676,
      "pose_mae_dx": 0.022741883993148804,
      "pose_mae_dy": 0.020888743922114372,
      "pose_rmse_dtheta": 0.20134112238883972,
      "pose_rmse_dx": 0.0653500109910965,
      "pose_rmse_dy": 0.050535429269075394,
      "pose_rmse_mean": 0.1057422012090683,
      "rmse_dtheta": 0.023779958486557007,
      "rmse_dx": 0.00633753277361393,
      "rmse_dy": 0.004623368848115206,
      "rmse_mean": 0.011580287478864193,
      "rotation_flip": 0.0032697548158466816,
      "sparse_tokens": 32073.0,
      "step": 2730,
      "turn_loss": 0.06980939209461212,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.1268816205166326,
      "grad_norm": 0.6549839377403259,
      "learning_rate": 8.85559859872694e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.011328471824526787,
      "mae_dx": 0.0028608457650989294,
      "mae_dy": 0.003299933625385165,
      "pose_mae_dtheta": 0.08039768040180206,
      "pose_mae_dx": 0.036784134805202484,
      "pose_mae_dy": 0.03372381255030632,
      "pose_rmse_dtheta": 0.18432283401489258,
      "pose_rmse_dx": 0.09622509777545929,
      "pose_rmse_dy": 0.08046697080135345,
      "pose_rmse_mean": 0.1203383058309555,
      "rmse_dtheta": 0.02342701144516468,
      "rmse_dx": 0.007187175564467907,
      "rmse_dy": 0.0074202073737978935,
      "rmse_mean": 0.012678131461143494,
      "rotation_flip": 0.004751462023705244,
      "sparse_tokens": 32185.0,
      "step": 2731,
      "turn_loss": 0.11495961993932724,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12692808028247538,
      "grad_norm": 0.5216545462608337,
      "learning_rate": 8.854756619996418e-06,
      "loss": 0.0926,
      "mae_dtheta": 0.011816078796982765,
      "mae_dx": 0.0022193207405507565,
      "mae_dy": 0.002957977121695876,
      "pose_mae_dtheta": 0.08053591102361679,
      "pose_mae_dx": 0.03020552732050419,
      "pose_mae_dy": 0.03836387023329735,
      "pose_rmse_dtheta": 0.17690829932689667,
      "pose_rmse_dx": 0.07301238179206848,
      "pose_rmse_dy": 0.08618709444999695,
      "pose_rmse_mean": 0.11203593015670776,
      "rmse_dtheta": 0.02444450929760933,
      "rmse_dx": 0.006978977005928755,
      "rmse_dy": 0.005880793556571007,
      "rmse_mean": 0.0124347610399127,
      "rotation_flip": 0.00587803078815341,
      "sparse_tokens": 32073.0,
      "step": 2732,
      "turn_loss": 0.09663090854883194,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12697454004831815,
      "grad_norm": 0.7706682085990906,
      "learning_rate": 8.853914371700695e-06,
      "loss": 0.2057,
      "mae_dtheta": 0.01217857375741005,
      "mae_dx": 0.0024341759271919727,
      "mae_dy": 0.003947665449231863,
      "pose_mae_dtheta": 0.09045491367578506,
      "pose_mae_dx": 0.03358404338359833,
      "pose_mae_dy": 0.0409676693379879,
      "pose_rmse_dtheta": 0.19049859046936035,
      "pose_rmse_dx": 0.08250869065523148,
      "pose_rmse_dy": 0.10922874510288239,
      "pose_rmse_mean": 0.12741200625896454,
      "rmse_dtheta": 0.022798052057623863,
      "rmse_dx": 0.006241981405764818,
      "rmse_dy": 0.008721829392015934,
      "rmse_mean": 0.01258728839457035,
      "rotation_flip": 0.0023687328211963177,
      "sparse_tokens": 32073.0,
      "step": 2733,
      "turn_loss": 0.11603450775146484,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.12702099981416093,
      "grad_norm": 0.651181161403656,
      "learning_rate": 8.853071853898675e-06,
      "loss": 0.1686,
      "mae_dtheta": 0.009662923403084278,
      "mae_dx": 0.0018629756523296237,
      "mae_dy": 0.0015574253629893064,
      "pose_mae_dtheta": 0.0716157853603363,
      "pose_mae_dx": 0.019860301166772842,
      "pose_mae_dy": 0.018475156277418137,
      "pose_rmse_dtheta": 0.22091172635555267,
      "pose_rmse_dx": 0.05018389970064163,
      "pose_rmse_dy": 0.04533560946583748,
      "pose_rmse_mean": 0.10547708719968796,
      "rmse_dtheta": 0.026335665956139565,
      "rmse_dx": 0.005138790234923363,
      "rmse_dy": 0.0035527138970792294,
      "rmse_mean": 0.011675722897052765,
      "rotation_flip": 0.0069135804660618305,
      "sparse_tokens": 32153.0,
      "step": 2734,
      "turn_loss": 0.07956395298242569,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.1270674595800037,
      "grad_norm": 0.7371661067008972,
      "learning_rate": 8.852229066649271e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.016634531319141388,
      "mae_dx": 0.008081912063062191,
      "mae_dy": 0.004584765061736107,
      "pose_mae_dtheta": 0.14610056579113007,
      "pose_mae_dx": 0.05213846266269684,
      "pose_mae_dy": 0.0369223915040493,
      "pose_rmse_dtheta": 0.24026186764240265,
      "pose_rmse_dx": 0.1548113375902176,
      "pose_rmse_dy": 0.06427189707756042,
      "pose_rmse_mean": 0.15311503410339355,
      "rmse_dtheta": 0.029676098376512527,
      "rmse_dx": 0.019142713397741318,
      "rmse_dy": 0.008677341043949127,
      "rmse_mean": 0.019165385514497757,
      "rotation_flip": 0.027397260069847107,
      "sparse_tokens": 3079.0,
      "step": 2735,
      "turn_loss": 0.20465458929538727,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.1271139193458465,
      "grad_norm": 0.5045849680900574,
      "learning_rate": 8.851386010011421e-06,
      "loss": 0.1544,
      "mae_dtheta": 0.02269313856959343,
      "mae_dx": 0.019646774977445602,
      "mae_dy": 0.004842864349484444,
      "pose_mae_dtheta": 0.1386679708957672,
      "pose_mae_dx": 0.13228285312652588,
      "pose_mae_dy": 0.08478691428899765,
      "pose_rmse_dtheta": 0.2360972762107849,
      "pose_rmse_dx": 0.27782827615737915,
      "pose_rmse_dy": 0.1622856706380844,
      "pose_rmse_mean": 0.22540375590324402,
      "rmse_dtheta": 0.03504015877842903,
      "rmse_dx": 0.03268953785300255,
      "rmse_dy": 0.009502565488219261,
      "rmse_mean": 0.025744087994098663,
      "rotation_flip": 0.013333333656191826,
      "sparse_tokens": 4906.0,
      "step": 2736,
      "turn_loss": 0.2874934673309326,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 8465.0,
      "epoch": 0.1271603791116893,
      "grad_norm": 0.4746060073375702,
      "learning_rate": 8.850542684044078e-06,
      "loss": 0.0962,
      "mae_dtheta": 0.025919234380126,
      "mae_dx": 0.009202565997838974,
      "mae_dy": 0.0035794521681964397,
      "pose_mae_dtheta": 0.18408426642417908,
      "pose_mae_dx": 0.05506852641701698,
      "pose_mae_dy": 0.04537585377693176,
      "pose_rmse_dtheta": 0.3842235803604126,
      "pose_rmse_dx": 0.14956137537956238,
      "pose_rmse_dy": 0.12099840492010117,
      "pose_rmse_mean": 0.21826112270355225,
      "rmse_dtheta": 0.04408784583210945,
      "rmse_dx": 0.020988965407013893,
      "rmse_dy": 0.007305422332137823,
      "rmse_mean": 0.02412741258740425,
      "rotation_flip": 0.01262626238167286,
      "sparse_tokens": 6942.0,
      "step": 2737,
      "turn_loss": 0.19048625230789185,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.12720683887753206,
      "grad_norm": 0.5339279174804688,
      "learning_rate": 8.84969908880622e-06,
      "loss": 0.091,
      "mae_dtheta": 0.03378473222255707,
      "mae_dx": 0.00858862604945898,
      "mae_dy": 0.005856318399310112,
      "pose_mae_dtheta": 0.27435582876205444,
      "pose_mae_dx": 0.08921751379966736,
      "pose_mae_dy": 0.08510632812976837,
      "pose_rmse_dtheta": 0.4940105974674225,
      "pose_rmse_dx": 0.19869710505008698,
      "pose_rmse_dy": 0.16870324313640594,
      "pose_rmse_mean": 0.2871370017528534,
      "rmse_dtheta": 0.051551442593336105,
      "rmse_dx": 0.019417958334088326,
      "rmse_dy": 0.010296185500919819,
      "rmse_mean": 0.027088530361652374,
      "rotation_flip": 0.01065246295183897,
      "sparse_tokens": 12619.0,
      "step": 2738,
      "turn_loss": 0.29687702655792236,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12725329864337484,
      "grad_norm": 0.39566269516944885,
      "learning_rate": 8.84885522435684e-06,
      "loss": 0.1101,
      "mae_dtheta": 0.015170798636972904,
      "mae_dx": 0.004314298741519451,
      "mae_dy": 0.0030261108186095953,
      "pose_mae_dtheta": 0.10175477713346481,
      "pose_mae_dx": 0.0441165529191494,
      "pose_mae_dy": 0.04010521620512009,
      "pose_rmse_dtheta": 0.23092664778232574,
      "pose_rmse_dx": 0.10825935006141663,
      "pose_rmse_dy": 0.09241832047700882,
      "pose_rmse_mean": 0.1438681185245514,
      "rmse_dtheta": 0.030400799587368965,
      "rmse_dx": 0.012246562168002129,
      "rmse_dy": 0.006332914344966412,
      "rmse_mean": 0.01632675901055336,
      "rotation_flip": 0.006941431667655706,
      "sparse_tokens": 32089.0,
      "step": 2739,
      "turn_loss": 0.14640912413597107,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25311.0,
      "epoch": 0.12729975840921762,
      "grad_norm": 0.9494799375534058,
      "learning_rate": 8.848011090754946e-06,
      "loss": 0.1754,
      "mae_dtheta": 0.03129469230771065,
      "mae_dx": 0.011680441908538342,
      "mae_dy": 0.006958452984690666,
      "pose_mae_dtheta": 0.24734781682491302,
      "pose_mae_dx": 0.10420964658260345,
      "pose_mae_dy": 0.06517227739095688,
      "pose_rmse_dtheta": 0.43196243047714233,
      "pose_rmse_dx": 0.23918300867080688,
      "pose_rmse_dy": 0.168439581990242,
      "pose_rmse_mean": 0.2798616886138916,
      "rmse_dtheta": 0.04842519760131836,
      "rmse_dx": 0.023320384323596954,
      "rmse_dy": 0.016559449955821037,
      "rmse_mean": 0.029435012489557266,
      "rotation_flip": 0.01232394389808178,
      "sparse_tokens": 19903.0,
      "step": 2740,
      "turn_loss": 0.27973297238349915,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1273462181750604,
      "grad_norm": 0.6981674432754517,
      "learning_rate": 8.847166688059572e-06,
      "loss": 0.2258,
      "mae_dtheta": 0.006646552123129368,
      "mae_dx": 0.0015749534359201789,
      "mae_dy": 0.0011726563097909093,
      "pose_mae_dtheta": 0.04312891513109207,
      "pose_mae_dx": 0.015282518230378628,
      "pose_mae_dy": 0.017605368047952652,
      "pose_rmse_dtheta": 0.09725216031074524,
      "pose_rmse_dx": 0.03666355088353157,
      "pose_rmse_dy": 0.03680451214313507,
      "pose_rmse_mean": 0.05690674111247063,
      "rmse_dtheta": 0.016538823023438454,
      "rmse_dx": 0.004489021375775337,
      "rmse_dy": 0.0023345600347965956,
      "rmse_mean": 0.007787467911839485,
      "rotation_flip": 0.00542005430907011,
      "sparse_tokens": 32137.0,
      "step": 2741,
      "turn_loss": 0.05086280778050423,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32763.0,
      "epoch": 0.12739267794090317,
      "grad_norm": 0.5942119359970093,
      "learning_rate": 8.846322016329767e-06,
      "loss": 0.1756,
      "mae_dtheta": 0.04150569438934326,
      "mae_dx": 0.011131186969578266,
      "mae_dy": 0.005831102374941111,
      "pose_mae_dtheta": 0.3378225564956665,
      "pose_mae_dx": 0.08664364367723465,
      "pose_mae_dy": 0.07769996672868729,
      "pose_rmse_dtheta": 0.5650044679641724,
      "pose_rmse_dx": 0.18310295045375824,
      "pose_rmse_dy": 0.22770273685455322,
      "pose_rmse_mean": 0.32527005672454834,
      "rmse_dtheta": 0.059077970683574677,
      "rmse_dx": 0.022504374384880066,
      "rmse_dy": 0.013139939866960049,
      "rmse_mean": 0.03157409653067589,
      "rotation_flip": 0.019370460882782936,
      "sparse_tokens": 26344.0,
      "step": 2742,
      "turn_loss": 0.3475741147994995,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12743913770674595,
      "grad_norm": 0.45707225799560547,
      "learning_rate": 8.845477075624598e-06,
      "loss": 0.1464,
      "mae_dtheta": 0.009829635731875896,
      "mae_dx": 0.0016604423290118575,
      "mae_dy": 0.002082462888211012,
      "pose_mae_dtheta": 0.06761743128299713,
      "pose_mae_dx": 0.02055511251091957,
      "pose_mae_dy": 0.025211868807673454,
      "pose_rmse_dtheta": 0.16716477274894714,
      "pose_rmse_dx": 0.04913809150457382,
      "pose_rmse_dy": 0.05186865106225014,
      "pose_rmse_mean": 0.08939050883054733,
      "rmse_dtheta": 0.021077176555991173,
      "rmse_dx": 0.004828971344977617,
      "rmse_dy": 0.004022898152470589,
      "rmse_mean": 0.009976348839700222,
      "rotation_flip": 0.006595218554139137,
      "sparse_tokens": 32073.0,
      "step": 2743,
      "turn_loss": 0.08463089168071747,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34063.0,
      "epoch": 0.12748559747258875,
      "grad_norm": 0.5048813223838806,
      "learning_rate": 8.844631866003155e-06,
      "loss": 0.1391,
      "mae_dtheta": 0.039106447249650955,
      "mae_dx": 0.01089012622833252,
      "mae_dy": 0.006634471006691456,
      "pose_mae_dtheta": 0.30539095401763916,
      "pose_mae_dx": 0.08075934648513794,
      "pose_mae_dy": 0.06809862703084946,
      "pose_rmse_dtheta": 0.5192322134971619,
      "pose_rmse_dx": 0.16760452091693878,
      "pose_rmse_dy": 0.17497625946998596,
      "pose_rmse_mean": 0.28727099299430847,
      "rmse_dtheta": 0.05785331875085831,
      "rmse_dx": 0.02176831290125847,
      "rmse_dy": 0.015884103253483772,
      "rmse_mean": 0.03183524310588837,
      "rotation_flip": 0.01886792480945587,
      "sparse_tokens": 27600.0,
      "step": 2744,
      "turn_loss": 0.3522525131702423,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12753205723843153,
      "grad_norm": 0.7378755807876587,
      "learning_rate": 8.84378638752454e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.0115757891908288,
      "mae_dx": 0.002884150482714176,
      "mae_dy": 0.002349560149013996,
      "pose_mae_dtheta": 0.08798320591449738,
      "pose_mae_dx": 0.03040042705833912,
      "pose_mae_dy": 0.03190821036696434,
      "pose_rmse_dtheta": 0.22805775701999664,
      "pose_rmse_dx": 0.07450886070728302,
      "pose_rmse_dy": 0.08035869151353836,
      "pose_rmse_mean": 0.12764176726341248,
      "rmse_dtheta": 0.027050724253058434,
      "rmse_dx": 0.008794398978352547,
      "rmse_dy": 0.006288115866482258,
      "rmse_mean": 0.014044413343071938,
      "rotation_flip": 0.005018248222768307,
      "sparse_tokens": 32105.0,
      "step": 2745,
      "turn_loss": 0.09828554093837738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.1275785170042743,
      "grad_norm": 0.5169161558151245,
      "learning_rate": 8.84294064024788e-06,
      "loss": 0.1314,
      "mae_dtheta": 0.02363922819495201,
      "mae_dx": 0.012968932278454304,
      "mae_dy": 0.0035306415520608425,
      "pose_mae_dtheta": 0.1803174614906311,
      "pose_mae_dx": 0.09922675788402557,
      "pose_mae_dy": 0.03995191305875778,
      "pose_rmse_dtheta": 0.3510357439517975,
      "pose_rmse_dx": 0.2363436073064804,
      "pose_rmse_dy": 0.10578825324773788,
      "pose_rmse_mean": 0.2310558557510376,
      "rmse_dtheta": 0.040381643921136856,
      "rmse_dx": 0.026250433176755905,
      "rmse_dy": 0.00883440114557743,
      "rmse_mean": 0.02515549212694168,
      "rotation_flip": 0.011173184029757977,
      "sparse_tokens": 22688.0,
      "step": 2746,
      "turn_loss": 0.18797306716442108,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.12762497677011708,
      "grad_norm": 0.6353266835212708,
      "learning_rate": 8.84209462423232e-06,
      "loss": 0.1134,
      "mae_dtheta": 0.02836037240922451,
      "mae_dx": 0.0065886517986655235,
      "mae_dy": 0.004232784733176231,
      "pose_mae_dtheta": 0.2070532888174057,
      "pose_mae_dx": 0.05555340647697449,
      "pose_mae_dy": 0.04424018785357475,
      "pose_rmse_dtheta": 0.36439692974090576,
      "pose_rmse_dx": 0.126779705286026,
      "pose_rmse_dy": 0.10232909023761749,
      "pose_rmse_mean": 0.19783525168895721,
      "rmse_dtheta": 0.045239802449941635,
      "rmse_dx": 0.015879595652222633,
      "rmse_dy": 0.009198770858347416,
      "rmse_mean": 0.02343939058482647,
      "rotation_flip": 0.010849909856915474,
      "sparse_tokens": 8868.0,
      "step": 2747,
      "turn_loss": 0.21329502761363983,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12767143653595986,
      "grad_norm": 0.5255523920059204,
      "learning_rate": 8.841248339537018e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.01282249391078949,
      "mae_dx": 0.0030597697477787733,
      "mae_dy": 0.0030443796422332525,
      "pose_mae_dtheta": 0.08680099993944168,
      "pose_mae_dx": 0.034001726657152176,
      "pose_mae_dy": 0.03673504665493965,
      "pose_rmse_dtheta": 0.1989203840494156,
      "pose_rmse_dx": 0.09440905600786209,
      "pose_rmse_dy": 0.08213873207569122,
      "pose_rmse_mean": 0.12515607476234436,
      "rmse_dtheta": 0.025908097624778748,
      "rmse_dx": 0.009024522267282009,
      "rmse_dy": 0.007792520336806774,
      "rmse_mean": 0.014241714030504227,
      "rotation_flip": 0.005474452394992113,
      "sparse_tokens": 32089.0,
      "step": 2748,
      "turn_loss": 0.14049960672855377,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.12771789630180264,
      "grad_norm": 0.5356700420379639,
      "learning_rate": 8.84040178622116e-06,
      "loss": 0.1364,
      "mae_dtheta": 0.012681139633059502,
      "mae_dx": 0.0019325421890243888,
      "mae_dy": 0.00392130296677351,
      "pose_mae_dtheta": 0.09402929246425629,
      "pose_mae_dx": 0.028989236801862717,
      "pose_mae_dy": 0.045212119817733765,
      "pose_rmse_dtheta": 0.22116684913635254,
      "pose_rmse_dx": 0.0765603631734848,
      "pose_rmse_dy": 0.1193925142288208,
      "pose_rmse_mean": 0.13903991878032684,
      "rmse_dtheta": 0.025581128895282745,
      "rmse_dx": 0.005254452116787434,
      "rmse_dy": 0.009069163352251053,
      "rmse_mean": 0.013301581144332886,
      "rotation_flip": 0.0073426575399935246,
      "sparse_tokens": 32057.0,
      "step": 2749,
      "turn_loss": 0.11066673696041107,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.1277643560676454,
      "grad_norm": 1.1076234579086304,
      "learning_rate": 8.839554964343944e-06,
      "loss": 0.0953,
      "mae_dtheta": 0.010266110301017761,
      "mae_dx": 0.0021352446638047695,
      "mae_dy": 0.00029831999563612044,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999992847442627,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.05210876464844,
      "model/head/act_norm_mean": 130.4603357796717,
      "model/head/act_norm_min": 87.72422790527344,
      "model/head/act_over_embed": 89.65356413669727,
      "model/head/grad_frac": 0.07506868988275528,
      "model/head/grad_norm": 0.0750686377286911,
      "model/head/grad_zero_frac": 0.000163394957780838,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6771721117424242,
      "model/head/update_ratio": 0.0012970486423000693,
      "model/head/weight_delta": 6.119089603424072,
      "model/head/weight_delta_rel": 0.10734695941209793,
      "model/head/weight_norm": 57.87649917602539,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.415355920791626,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41529118074915716,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4152229428291321,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28539198742811167,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07876894623041153,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07876888662576675,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5405779953319502,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002556883729994297,
      "model/modality_embedder.encoders.pose/weight_delta": 2.0124213695526123,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06575208157300949,
      "model/modality_embedder.encoders.pose/weight_norm": 30.806596755981445,
      "model/modality_embedder/grad_frac": 0.07876894623041153,
      "model/modality_embedder/grad_norm": 0.07876888662576675,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5405779953319502,
      "model/modality_embedder/update_ratio": 0.002556883729994297,
      "model/modality_embedder/weight_delta": 2.0124213695526123,
      "model/modality_embedder/weight_delta_rel": 0.06575208157300949,
      "model/modality_embedder/weight_norm": 30.806596755981445,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.40443420410156,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.512488476030143,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.090368270874023,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.532420932408197,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05239623785018921,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.052396200597286224,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018940902082249522,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.3132654428482056,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04785618558526039,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.66299057006836,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.01268768310547,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.65991762866763,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.16400146484375,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.32094498850165,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05388462170958519,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.053884584456682205,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018412311328575015,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.6441929340362549,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.056956127285957336,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.265518188476562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.04611206054688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.608215087381755,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.492977142333984,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.659833242378188,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06666387617588043,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06666383147239685,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002206909004598856,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.7617419958114624,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05915599688887596,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.206876754760742,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.302001953125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 30.357661435786436,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.390985488891602,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.862069151576648,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08871699124574661,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08871692419052124,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.003000563709065318,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.5005850791931152,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05128287523984909,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.566753387451172,
      "model/normalizer/grad_frac": 0.3266441226005554,
      "model/normalizer/grad_norm": 0.3266438841819763,
      "model/normalizer/grad_zero_frac": 0.00012171905837021768,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004182861652225256,
      "model/normalizer/weight_delta": 3.2021243572235107,
      "model/normalizer/weight_delta_rel": 0.04124150797724724,
      "model/normalizer/weight_norm": 78.09101104736328,
      "pose_mae_dtheta": 0.07721807807683945,
      "pose_mae_dx": 0.018481535837054253,
      "pose_mae_dy": 0.003942032344639301,
      "pose_rmse_dtheta": 0.30379366874694824,
      "pose_rmse_dx": 0.04370323196053505,
      "pose_rmse_dy": 0.009669697843492031,
      "pose_rmse_mean": 0.11905553191900253,
      "rmse_dtheta": 0.03420215845108032,
      "rmse_dx": 0.005434225779026747,
      "rmse_dy": 0.0005533790681511164,
      "rmse_mean": 0.01339658908545971,
      "rotation_flip": 0.0011160714784637094,
      "sparse_tokens": 32249.0,
      "step": 2750,
      "turn_loss": 0.053965743631124496,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1278108158334882,
      "grad_norm": 0.9117393493652344,
      "learning_rate": 8.838707873964587e-06,
      "loss": 0.1601,
      "mae_dtheta": 0.008159514516592026,
      "mae_dx": 0.002275819191709161,
      "mae_dy": 0.002185686957091093,
      "pose_mae_dtheta": 0.05473101884126663,
      "pose_mae_dx": 0.01847117394208908,
      "pose_mae_dy": 0.02297659032046795,
      "pose_rmse_dtheta": 0.15378834307193756,
      "pose_rmse_dx": 0.04785682260990143,
      "pose_rmse_dy": 0.07021380960941315,
      "pose_rmse_mean": 0.09061966836452484,
      "rmse_dtheta": 0.02074485272169113,
      "rmse_dx": 0.006986288819462061,
      "rmse_dy": 0.007430740166455507,
      "rmse_mean": 0.011720627546310425,
      "rotation_flip": 0.0050276522524654865,
      "sparse_tokens": 32105.0,
      "step": 2751,
      "turn_loss": 0.08856434375047684,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24338.0,
      "epoch": 0.12785727559933097,
      "grad_norm": 0.5328367352485657,
      "learning_rate": 8.83786051514233e-06,
      "loss": 0.1014,
      "mae_dtheta": 0.02360154688358307,
      "mae_dx": 0.010268481448292732,
      "mae_dy": 0.0037918335292488337,
      "pose_mae_dtheta": 0.16702166199684143,
      "pose_mae_dx": 0.08637459576129913,
      "pose_mae_dy": 0.05019749328494072,
      "pose_rmse_dtheta": 0.30368003249168396,
      "pose_rmse_dx": 0.1858217865228653,
      "pose_rmse_dy": 0.11759113520383835,
      "pose_rmse_mean": 0.20236432552337646,
      "rmse_dtheta": 0.0388878770172596,
      "rmse_dx": 0.022078583016991615,
      "rmse_dy": 0.006949161179363728,
      "rmse_mean": 0.02263854257762432,
      "rotation_flip": 0.011916584335267544,
      "sparse_tokens": 19469.0,
      "step": 2752,
      "turn_loss": 0.20612235367298126,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12790373536517377,
      "grad_norm": 0.3949681520462036,
      "learning_rate": 8.837012887936426e-06,
      "loss": 0.1469,
      "mae_dtheta": 0.009438120760023594,
      "mae_dx": 0.0016770424554124475,
      "mae_dy": 0.0025628230068832636,
      "pose_mae_dtheta": 0.06435869634151459,
      "pose_mae_dx": 0.02120327204465866,
      "pose_mae_dy": 0.030036713927984238,
      "pose_rmse_dtheta": 0.12927640974521637,
      "pose_rmse_dx": 0.04906487464904785,
      "pose_rmse_dy": 0.06773320585489273,
      "pose_rmse_mean": 0.08202483505010605,
      "rmse_dtheta": 0.01955290324985981,
      "rmse_dx": 0.004806219600141048,
      "rmse_dy": 0.006302017718553543,
      "rmse_mean": 0.010220380499958992,
      "rotation_flip": 0.006584362126886845,
      "sparse_tokens": 32089.0,
      "step": 2753,
      "turn_loss": 0.08448708057403564,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.12795019513101655,
      "grad_norm": 0.6231576204299927,
      "learning_rate": 8.836164992406151e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.025432482361793518,
      "mae_dx": 0.009546315297484398,
      "mae_dy": 0.003699028864502907,
      "pose_mae_dtheta": 0.19151797890663147,
      "pose_mae_dx": 0.06745151430368423,
      "pose_mae_dy": 0.031214354559779167,
      "pose_rmse_dtheta": 0.32095375657081604,
      "pose_rmse_dx": 0.16517478227615356,
      "pose_rmse_dy": 0.07162553817033768,
      "pose_rmse_mean": 0.18591803312301636,
      "rmse_dtheta": 0.04157811403274536,
      "rmse_dx": 0.02132079377770424,
      "rmse_dy": 0.008772841654717922,
      "rmse_mean": 0.023890582844614983,
      "rotation_flip": 0.022488756105303764,
      "sparse_tokens": 11955.0,
      "step": 2754,
      "turn_loss": 0.2124173492193222,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.12799665489685932,
      "grad_norm": 1.1891716718673706,
      "learning_rate": 8.835316828610801e-06,
      "loss": 0.1658,
      "mae_dtheta": 0.019947340711951256,
      "mae_dx": 0.0057038660161197186,
      "mae_dy": 0.008556010201573372,
      "pose_mae_dtheta": 0.16984882950782776,
      "pose_mae_dx": 0.07024286687374115,
      "pose_mae_dy": 0.08366496860980988,
      "pose_rmse_dtheta": 0.4148470461368561,
      "pose_rmse_dx": 0.19262166321277618,
      "pose_rmse_dy": 0.2505505084991455,
      "pose_rmse_mean": 0.2860064208507538,
      "rmse_dtheta": 0.04257384315133095,
      "rmse_dx": 0.013702484779059887,
      "rmse_dy": 0.020925957709550858,
      "rmse_mean": 0.02573409676551819,
      "rotation_flip": 0.008692216128110886,
      "sparse_tokens": 32057.0,
      "step": 2755,
      "turn_loss": 0.21653681993484497,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1280431146627021,
      "grad_norm": 0.7083687782287598,
      "learning_rate": 8.834468396609683e-06,
      "loss": 0.1423,
      "mae_dtheta": 0.00966173131018877,
      "mae_dx": 0.0018296904163435102,
      "mae_dy": 0.0018912818050011992,
      "pose_mae_dtheta": 0.07062087208032608,
      "pose_mae_dx": 0.022801073268055916,
      "pose_mae_dy": 0.02354314923286438,
      "pose_rmse_dtheta": 0.21192039549350739,
      "pose_rmse_dx": 0.058393694460392,
      "pose_rmse_dy": 0.057163137942552567,
      "pose_rmse_mean": 0.10915908217430115,
      "rmse_dtheta": 0.02468772977590561,
      "rmse_dx": 0.005259128753095865,
      "rmse_dy": 0.004356631077826023,
      "rmse_mean": 0.011434497311711311,
      "rotation_flip": 0.005231037270277739,
      "sparse_tokens": 32105.0,
      "step": 2756,
      "turn_loss": 0.0733407661318779,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30077.0,
      "epoch": 0.12808957442854488,
      "grad_norm": 0.6197129487991333,
      "learning_rate": 8.833619696462134e-06,
      "loss": 0.1893,
      "mae_dtheta": 0.04041256010532379,
      "mae_dx": 0.014839828945696354,
      "mae_dy": 0.006222489755600691,
      "pose_mae_dtheta": 0.33229440450668335,
      "pose_mae_dx": 0.11722227185964584,
      "pose_mae_dy": 0.07065500319004059,
      "pose_rmse_dtheta": 0.5355921387672424,
      "pose_rmse_dx": 0.26216208934783936,
      "pose_rmse_dy": 0.17549555003643036,
      "pose_rmse_mean": 0.3244166076183319,
      "rmse_dtheta": 0.05831025540828705,
      "rmse_dx": 0.02814546786248684,
      "rmse_dy": 0.01268132496625185,
      "rmse_mean": 0.0330456867814064,
      "rotation_flip": 0.01666666753590107,
      "sparse_tokens": 23039.0,
      "step": 2757,
      "turn_loss": 0.2839077115058899,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.12813603419438765,
      "grad_norm": 0.4577728807926178,
      "learning_rate": 8.832770728227502e-06,
      "loss": 0.1138,
      "mae_dtheta": 0.009814219549298286,
      "mae_dx": 0.0019474427681416273,
      "mae_dy": 0.0013071723515167832,
      "pose_mae_dtheta": 0.06774173676967621,
      "pose_mae_dx": 0.018313687294721603,
      "pose_mae_dy": 0.01626756601035595,
      "pose_rmse_dtheta": 0.19363562762737274,
      "pose_rmse_dx": 0.05467164143919945,
      "pose_rmse_dy": 0.041436098515987396,
      "pose_rmse_mean": 0.0965811237692833,
      "rmse_dtheta": 0.02495076134800911,
      "rmse_dx": 0.006438624579459429,
      "rmse_dy": 0.002891805022954941,
      "rmse_mean": 0.01142706349492073,
      "rotation_flip": 0.003779924474656582,
      "sparse_tokens": 32185.0,
      "step": 2758,
      "turn_loss": 0.0801299586892128,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.12818249396023043,
      "grad_norm": 0.5650161504745483,
      "learning_rate": 8.831921491965157e-06,
      "loss": 0.12,
      "mae_dtheta": 0.008817290887236595,
      "mae_dx": 0.0016814429545775056,
      "mae_dy": 0.002099619247019291,
      "pose_mae_dtheta": 0.06329814344644547,
      "pose_mae_dx": 0.01957952044904232,
      "pose_mae_dy": 0.027004927396774292,
      "pose_rmse_dtheta": 0.15668803453445435,
      "pose_rmse_dx": 0.05221676826477051,
      "pose_rmse_dy": 0.07387268543243408,
      "pose_rmse_mean": 0.09425916522741318,
      "rmse_dtheta": 0.020556863397359848,
      "rmse_dx": 0.006039701402187347,
      "rmse_dy": 0.004946255125105381,
      "rmse_mean": 0.010514273308217525,
      "rotation_flip": 0.00716524850577116,
      "sparse_tokens": 32057.0,
      "step": 2759,
      "turn_loss": 0.06675120443105698,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1282289537260732,
      "grad_norm": 0.6447307467460632,
      "learning_rate": 8.831071987734484e-06,
      "loss": 0.1191,
      "mae_dtheta": 0.011168192140758038,
      "mae_dx": 0.0021574338898062706,
      "mae_dy": 0.002295851707458496,
      "pose_mae_dtheta": 0.08102967590093613,
      "pose_mae_dx": 0.030219608917832375,
      "pose_mae_dy": 0.031654179096221924,
      "pose_rmse_dtheta": 0.18073326349258423,
      "pose_rmse_dx": 0.07670506834983826,
      "pose_rmse_dy": 0.07340016216039658,
      "pose_rmse_mean": 0.11027950048446655,
      "rmse_dtheta": 0.023763403296470642,
      "rmse_dx": 0.006102581974118948,
      "rmse_dy": 0.004784076940268278,
      "rmse_mean": 0.011550020426511765,
      "rotation_flip": 0.006376594305038452,
      "sparse_tokens": 32121.0,
      "step": 2760,
      "turn_loss": 0.08619371056556702,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.128275413491916,
      "grad_norm": 0.604863166809082,
      "learning_rate": 8.83022221559489e-06,
      "loss": 0.2006,
      "mae_dtheta": 0.049436572939157486,
      "mae_dx": 0.014263440854847431,
      "mae_dy": 0.009762556292116642,
      "pose_mae_dtheta": 0.4358164966106415,
      "pose_mae_dx": 0.12800738215446472,
      "pose_mae_dy": 0.12248446047306061,
      "pose_rmse_dtheta": 0.6743729114532471,
      "pose_rmse_dx": 0.25206851959228516,
      "pose_rmse_dy": 0.24769838154315948,
      "pose_rmse_mean": 0.3913799524307251,
      "rmse_dtheta": 0.06696886569261551,
      "rmse_dx": 0.026362551376223564,
      "rmse_dy": 0.01765121892094612,
      "rmse_mean": 0.03699421510100365,
      "rotation_flip": 0.008323424495756626,
      "sparse_tokens": 15030.0,
      "step": 2761,
      "turn_loss": 0.36258214712142944,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1283218732577588,
      "grad_norm": 0.6751190423965454,
      "learning_rate": 8.829372175605802e-06,
      "loss": 0.1213,
      "mae_dtheta": 0.010795017704367638,
      "mae_dx": 0.0021123518235981464,
      "mae_dy": 0.001515287789516151,
      "pose_mae_dtheta": 0.07758797705173492,
      "pose_mae_dx": 0.01988186128437519,
      "pose_mae_dy": 0.020110148936510086,
      "pose_rmse_dtheta": 0.2424970120191574,
      "pose_rmse_dx": 0.06159679591655731,
      "pose_rmse_dy": 0.04572893679141998,
      "pose_rmse_mean": 0.11660759150981903,
      "rmse_dtheta": 0.02713591791689396,
      "rmse_dx": 0.007250872906297445,
      "rmse_dy": 0.004025218077003956,
      "rmse_mean": 0.012804003432393074,
      "rotation_flip": 0.004303388763219118,
      "sparse_tokens": 32089.0,
      "step": 2762,
      "turn_loss": 0.07621853798627853,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13001.0,
      "epoch": 0.12836833302360157,
      "grad_norm": 0.5672761797904968,
      "learning_rate": 8.828521867826662e-06,
      "loss": 0.1112,
      "mae_dtheta": 0.033281244337558746,
      "mae_dx": 0.012397237122058868,
      "mae_dy": 0.0022925513330847025,
      "pose_mae_dtheta": 0.2928853929042816,
      "pose_mae_dx": 0.10615834593772888,
      "pose_mae_dy": 0.023979291319847107,
      "pose_rmse_dtheta": 0.4930518567562103,
      "pose_rmse_dx": 0.20475468039512634,
      "pose_rmse_dy": 0.054346442222595215,
      "pose_rmse_mean": 0.2507176697254181,
      "rmse_dtheta": 0.050284143537282944,
      "rmse_dx": 0.023166654631495476,
      "rmse_dy": 0.004566749092191458,
      "rmse_mean": 0.026005849242210388,
      "rotation_flip": 0.005769230891019106,
      "sparse_tokens": 10250.0,
      "step": 2763,
      "turn_loss": 0.22796015441417694,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.12841479278944434,
      "grad_norm": 0.7511783242225647,
      "learning_rate": 8.827671292316932e-06,
      "loss": 0.1709,
      "mae_dtheta": 0.029969507828354836,
      "mae_dx": 0.009863235056400299,
      "mae_dy": 0.004687848035246134,
      "pose_mae_dtheta": 0.2126549780368805,
      "pose_mae_dx": 0.07818900793790817,
      "pose_mae_dy": 0.058551155030727386,
      "pose_rmse_dtheta": 0.4160548150539398,
      "pose_rmse_dx": 0.17908349633216858,
      "pose_rmse_dy": 0.14433197677135468,
      "pose_rmse_mean": 0.24649010598659515,
      "rmse_dtheta": 0.048419684171676636,
      "rmse_dx": 0.02178078703582287,
      "rmse_dy": 0.010006295517086983,
      "rmse_mean": 0.026735588908195496,
      "rotation_flip": 0.016420360654592514,
      "sparse_tokens": 10499.0,
      "step": 2764,
      "turn_loss": 0.23623055219650269,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.12846125255528712,
      "grad_norm": 0.5693426132202148,
      "learning_rate": 8.826820449136096e-06,
      "loss": 0.1683,
      "mae_dtheta": 0.05306721851229668,
      "mae_dx": 0.012747682631015778,
      "mae_dy": 0.004603750072419643,
      "pose_mae_dtheta": 0.45994243025779724,
      "pose_mae_dx": 0.11006922274827957,
      "pose_mae_dy": 0.0521492175757885,
      "pose_rmse_dtheta": 0.7034997940063477,
      "pose_rmse_dx": 0.23423880338668823,
      "pose_rmse_dy": 0.12412147223949432,
      "pose_rmse_mean": 0.35395336151123047,
      "rmse_dtheta": 0.07120540738105774,
      "rmse_dx": 0.025524813681840897,
      "rmse_dy": 0.010748372413218021,
      "rmse_mean": 0.035826198756694794,
      "rotation_flip": 0.014204545877873898,
      "sparse_tokens": 14748.0,
      "step": 2765,
      "turn_loss": 0.33992570638656616,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.1285077123211299,
      "grad_norm": 0.4615738093852997,
      "learning_rate": 8.825969338343652e-06,
      "loss": 0.0952,
      "mae_dtheta": 0.007875187322497368,
      "mae_dx": 0.001326971803791821,
      "mae_dy": 0.00221297238022089,
      "pose_mae_dtheta": 0.054215479642152786,
      "pose_mae_dx": 0.024795515462756157,
      "pose_mae_dy": 0.028763391077518463,
      "pose_rmse_dtheta": 0.1118752509355545,
      "pose_rmse_dx": 0.0665043517947197,
      "pose_rmse_dy": 0.06816031038761139,
      "pose_rmse_mean": 0.0821799710392952,
      "rmse_dtheta": 0.016321606934070587,
      "rmse_dx": 0.004089453723281622,
      "rmse_dy": 0.004775912966579199,
      "rmse_mean": 0.008395658805966377,
      "rotation_flip": 0.004217629786580801,
      "sparse_tokens": 32041.0,
      "step": 2766,
      "turn_loss": 0.06794008612632751,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12855417208697267,
      "grad_norm": 0.5055583119392395,
      "learning_rate": 8.825117959999117e-06,
      "loss": 0.1345,
      "mae_dtheta": 0.010127706453204155,
      "mae_dx": 0.002038721926510334,
      "mae_dy": 0.0022065939847379923,
      "pose_mae_dtheta": 0.07154165953397751,
      "pose_mae_dx": 0.024425823241472244,
      "pose_mae_dy": 0.02878701314330101,
      "pose_rmse_dtheta": 0.159159317612648,
      "pose_rmse_dx": 0.05956327170133591,
      "pose_rmse_dy": 0.08083833754062653,
      "pose_rmse_mean": 0.09985363483428955,
      "rmse_dtheta": 0.020954791456460953,
      "rmse_dx": 0.006097855046391487,
      "rmse_dy": 0.0049680317752063274,
      "rmse_mean": 0.01067355927079916,
      "rotation_flip": 0.00344959762878716,
      "sparse_tokens": 32121.0,
      "step": 2767,
      "turn_loss": 0.08410437405109406,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.12860063185281545,
      "grad_norm": 0.5659350156784058,
      "learning_rate": 8.82426631416203e-06,
      "loss": 0.157,
      "mae_dtheta": 0.03446348384022713,
      "mae_dx": 0.017274871468544006,
      "mae_dy": 0.006002872716635466,
      "pose_mae_dtheta": 0.3005187213420868,
      "pose_mae_dx": 0.1241130530834198,
      "pose_mae_dy": 0.0772438794374466,
      "pose_rmse_dtheta": 0.6217688918113708,
      "pose_rmse_dx": 0.2216281294822693,
      "pose_rmse_dy": 0.1854243129491806,
      "pose_rmse_mean": 0.34294044971466064,
      "rmse_dtheta": 0.05507547780871391,
      "rmse_dx": 0.030040452256798744,
      "rmse_dy": 0.010845917277038097,
      "rmse_mean": 0.03198728337883949,
      "rotation_flip": 0.007692307699471712,
      "sparse_tokens": 2607.0,
      "step": 2768,
      "turn_loss": 0.26483267545700073,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.12864709161865825,
      "grad_norm": 0.4487851560115814,
      "learning_rate": 8.823414400891948e-06,
      "loss": 0.1069,
      "mae_dtheta": 0.031873010098934174,
      "mae_dx": 0.014171338640153408,
      "mae_dy": 0.0027397251687943935,
      "pose_mae_dtheta": 0.276557058095932,
      "pose_mae_dx": 0.12076873332262039,
      "pose_mae_dy": 0.04922398552298546,
      "pose_rmse_dtheta": 0.4838489592075348,
      "pose_rmse_dx": 0.2785201966762543,
      "pose_rmse_dy": 0.11989633738994598,
      "pose_rmse_mean": 0.2940885126590729,
      "rmse_dtheta": 0.05086897686123848,
      "rmse_dx": 0.0290371086448431,
      "rmse_dy": 0.005700287874788046,
      "rmse_mean": 0.02853545919060707,
      "rotation_flip": 0.009580838494002819,
      "sparse_tokens": 15879.0,
      "step": 2769,
      "turn_loss": 0.2537461817264557,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12869355138450103,
      "grad_norm": 0.5079725384712219,
      "learning_rate": 8.822562220248445e-06,
      "loss": 0.1464,
      "mae_dtheta": 0.013734723441302776,
      "mae_dx": 0.0034243599511682987,
      "mae_dy": 0.0037747195456176996,
      "pose_mae_dtheta": 0.0990193709731102,
      "pose_mae_dx": 0.03914576396346092,
      "pose_mae_dy": 0.040254589170217514,
      "pose_rmse_dtheta": 0.22899451851844788,
      "pose_rmse_dx": 0.09384579956531525,
      "pose_rmse_dy": 0.08122848719358444,
      "pose_rmse_mean": 0.13468961417675018,
      "rmse_dtheta": 0.027106398716568947,
      "rmse_dx": 0.009969063103199005,
      "rmse_dy": 0.008348356001079082,
      "rmse_mean": 0.01514127291738987,
      "rotation_flip": 0.00428194971755147,
      "sparse_tokens": 32073.0,
      "step": 2770,
      "turn_loss": 0.13184908032417297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.1287400111503438,
      "grad_norm": 0.4233867824077606,
      "learning_rate": 8.821709772291113e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.006595461163669825,
      "mae_dx": 0.0008444737177342176,
      "mae_dy": 0.0010519250063225627,
      "pose_mae_dtheta": 0.04655785113573074,
      "pose_mae_dx": 0.0111461840569973,
      "pose_mae_dy": 0.020630821585655212,
      "pose_rmse_dtheta": 0.15994852781295776,
      "pose_rmse_dx": 0.03191440925002098,
      "pose_rmse_dy": 0.05749558284878731,
      "pose_rmse_mean": 0.08311951160430908,
      "rmse_dtheta": 0.019899651408195496,
      "rmse_dx": 0.0031450220849364996,
      "rmse_dy": 0.00227944809012115,
      "rmse_mean": 0.008441373705863953,
      "rotation_flip": 0.002582311164587736,
      "sparse_tokens": 32041.0,
      "step": 2771,
      "turn_loss": 0.04063641279935837,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23618.0,
      "epoch": 0.12878647091618659,
      "grad_norm": 0.5156242847442627,
      "learning_rate": 8.820857057079566e-06,
      "loss": 0.1069,
      "mae_dtheta": 0.019733387976884842,
      "mae_dx": 0.009857180528342724,
      "mae_dy": 0.004892313852906227,
      "pose_mae_dtheta": 0.1508183628320694,
      "pose_mae_dx": 0.08302377909421921,
      "pose_mae_dy": 0.06565747410058975,
      "pose_rmse_dtheta": 0.28096166253089905,
      "pose_rmse_dx": 0.1975058913230896,
      "pose_rmse_dy": 0.14926426112651825,
      "pose_rmse_mean": 0.20924393832683563,
      "rmse_dtheta": 0.032803382724523544,
      "rmse_dx": 0.02162286452949047,
      "rmse_dy": 0.009017201140522957,
      "rmse_mean": 0.021147815510630608,
      "rotation_flip": 0.00729040103033185,
      "sparse_tokens": 19951.0,
      "step": 2772,
      "turn_loss": 0.22593757510185242,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.12883293068202936,
      "grad_norm": 0.46449828147888184,
      "learning_rate": 8.820004074673433e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.025102604180574417,
      "mae_dx": 0.013300301507115364,
      "mae_dy": 0.0034651646856218576,
      "pose_mae_dtheta": 0.160605326294899,
      "pose_mae_dx": 0.09823869168758392,
      "pose_mae_dy": 0.03106485866010189,
      "pose_rmse_dtheta": 0.31027090549468994,
      "pose_rmse_dx": 0.18664400279521942,
      "pose_rmse_dy": 0.0902203693985939,
      "pose_rmse_mean": 0.19571177661418915,
      "rmse_dtheta": 0.0441865511238575,
      "rmse_dx": 0.025529710575938225,
      "rmse_dy": 0.00779950525611639,
      "rmse_mean": 0.025838589295744896,
      "rotation_flip": 0.004608294926583767,
      "sparse_tokens": 4135.0,
      "step": 2773,
      "turn_loss": 0.24159768223762512,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.12887939044787214,
      "grad_norm": 0.39458146691322327,
      "learning_rate": 8.819150825132368e-06,
      "loss": 0.1222,
      "mae_dtheta": 0.008873386308550835,
      "mae_dx": 0.002111877780407667,
      "mae_dy": 0.0023333837743848562,
      "pose_mae_dtheta": 0.06298928707838058,
      "pose_mae_dx": 0.027328791096806526,
      "pose_mae_dy": 0.02580932527780533,
      "pose_rmse_dtheta": 0.17403243482112885,
      "pose_rmse_dx": 0.07247807830572128,
      "pose_rmse_dy": 0.06548456102609634,
      "pose_rmse_mean": 0.10399835556745529,
      "rmse_dtheta": 0.021746009588241577,
      "rmse_dx": 0.00544566847383976,
      "rmse_dy": 0.0055346121080219746,
      "rmse_mean": 0.010908763855695724,
      "rotation_flip": 0.004818221554160118,
      "sparse_tokens": 32121.0,
      "step": 2774,
      "turn_loss": 0.07963892817497253,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32115.0,
      "epoch": 0.12892585021371492,
      "grad_norm": 0.750129222869873,
      "learning_rate": 8.818297308516034e-06,
      "loss": 0.249,
      "mae_dtheta": 0.0295801293104887,
      "mae_dx": 0.009700740687549114,
      "mae_dy": 0.003820895217359066,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.750129222869873,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.80763244628906,
      "model/head/act_norm_mean": 107.23936631944444,
      "model/head/act_norm_min": 68.1238021850586,
      "model/head/act_over_embed": 73.69589652548784,
      "model/head/grad_frac": 0.11862850934267044,
      "model/head/grad_norm": 0.08898670971393585,
      "model/head/grad_zero_frac": 0.0001573667977936566,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6796973642676768,
      "model/head/update_ratio": 0.0015373547794297338,
      "model/head/weight_delta": 6.145351409912109,
      "model/head/weight_delta_rel": 0.10780766606330872,
      "model/head/weight_norm": 57.88300323486328,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4154930114746094,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41541572570800783,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4153587818145752,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28547757588984213,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06169237568974495,
      "model/modality_embedder.encoders.pose/grad_norm": 0.046277254819869995,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.51462890625,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015021383296698332,
      "model/modality_embedder.encoders.pose/weight_delta": 2.019563674926758,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06598544120788574,
      "model/modality_embedder.encoders.pose/weight_norm": 30.807584762573242,
      "model/modality_embedder/grad_frac": 0.06169237568974495,
      "model/modality_embedder/grad_norm": 0.046277254819869995,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.51462890625,
      "model/modality_embedder/update_ratio": 0.0015021383296698332,
      "model/modality_embedder/weight_delta": 2.019563674926758,
      "model/modality_embedder/weight_delta_rel": 0.06598544120788574,
      "model/modality_embedder/weight_norm": 30.807584762573242,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.14391326904297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.20782728074395,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.970879554748535,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.94863618242947,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10172901302576065,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.07630990445613861,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0027583963237702847,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.3220824003219604,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.048177480697631836,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.66459083557129,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.79324340820312,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.114300244508577,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.637171745300293,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.571572889662114,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09434966742992401,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07077444344758987,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0024180852342396975,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.6562376022338867,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05737336352467537,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.268796920776367,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.3885269165039,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.849594656886325,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.12884521484375,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.764083455930354,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09976820647716522,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0748390480875969,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0024772509932518005,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.7746882438659668,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.05959070846438408,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.21052360534668,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.3382797241211,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.78323162177329,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.580916404724121,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.09289688119516,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10360252112150192,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07771527767181396,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002628218149766326,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.5121850967407227,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05167930945754051,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.569568634033203,
      "model/normalizer/grad_frac": 0.4300382733345032,
      "model/normalizer/grad_norm": 0.32258427143096924,
      "model/normalizer/grad_zero_frac": 0.00018907814228441566,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004130674991756678,
      "model/normalizer/weight_delta": 3.225440502166748,
      "model/normalizer/weight_delta_rel": 0.04154180735349655,
      "model/normalizer/weight_norm": 78.09481048583984,
      "pose_mae_dtheta": 0.2206329107284546,
      "pose_mae_dx": 0.0734553262591362,
      "pose_mae_dy": 0.03836574777960777,
      "pose_rmse_dtheta": 0.4240456223487854,
      "pose_rmse_dx": 0.16079206764698029,
      "pose_rmse_dy": 0.09019815921783447,
      "pose_rmse_mean": 0.225011944770813,
      "rmse_dtheta": 0.04927998408675194,
      "rmse_dx": 0.020145799964666367,
      "rmse_dy": 0.007726522162556648,
      "rmse_mean": 0.025717435404658318,
      "rotation_flip": 0.013698630034923553,
      "sparse_tokens": 25377.0,
      "step": 2775,
      "turn_loss": 0.22247323393821716,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1289723099795577,
      "grad_norm": 0.5277089476585388,
      "learning_rate": 8.817443524884119e-06,
      "loss": 0.0869,
      "mae_dtheta": 0.014319130219519138,
      "mae_dx": 0.0025804585311561823,
      "mae_dy": 0.004204730503261089,
      "pose_mae_dtheta": 0.09310944378376007,
      "pose_mae_dx": 0.03379447013139725,
      "pose_mae_dy": 0.04275774210691452,
      "pose_rmse_dtheta": 0.1885351687669754,
      "pose_rmse_dx": 0.08437291532754898,
      "pose_rmse_dy": 0.08941608667373657,
      "pose_rmse_mean": 0.12077473104000092,
      "rmse_dtheta": 0.02594064548611641,
      "rmse_dx": 0.007118972484022379,
      "rmse_dy": 0.00828704982995987,
      "rmse_mean": 0.01378222368657589,
      "rotation_flip": 0.008081518113613129,
      "sparse_tokens": 32089.0,
      "step": 2776,
      "turn_loss": 0.1185070127248764,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1290187697454005,
      "grad_norm": 0.5736202597618103,
      "learning_rate": 8.81658947429633e-06,
      "loss": 0.1882,
      "mae_dtheta": 0.009815782308578491,
      "mae_dx": 0.0016075399471446872,
      "mae_dy": 0.0027573383413255215,
      "pose_mae_dtheta": 0.07140569388866425,
      "pose_mae_dx": 0.029102511703968048,
      "pose_mae_dy": 0.0354711152613163,
      "pose_rmse_dtheta": 0.1608162820339203,
      "pose_rmse_dx": 0.07646690309047699,
      "pose_rmse_dy": 0.08827704936265945,
      "pose_rmse_mean": 0.10852008312940598,
      "rmse_dtheta": 0.019663967192173004,
      "rmse_dx": 0.00460456358268857,
      "rmse_dy": 0.005738305393606424,
      "rmse_mean": 0.010002278722822666,
      "rotation_flip": 0.002053388161584735,
      "sparse_tokens": 32089.0,
      "step": 2777,
      "turn_loss": 0.08981622010469437,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.12906522951124327,
      "grad_norm": 0.3714509904384613,
      "learning_rate": 8.81573515681239e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.038925912231206894,
      "mae_dx": 0.012088627554476261,
      "mae_dy": 0.005246295128017664,
      "pose_mae_dtheta": 0.32167893648147583,
      "pose_mae_dx": 0.09478054940700531,
      "pose_mae_dy": 0.05704546719789505,
      "pose_rmse_dtheta": 0.5373908281326294,
      "pose_rmse_dx": 0.18200986087322235,
      "pose_rmse_dy": 0.14344602823257446,
      "pose_rmse_mean": 0.2876155972480774,
      "rmse_dtheta": 0.05673208087682724,
      "rmse_dx": 0.02246932126581669,
      "rmse_dy": 0.011937088333070278,
      "rmse_mean": 0.03037949651479721,
      "rotation_flip": 0.010471204295754433,
      "sparse_tokens": 17686.0,
      "step": 2778,
      "turn_loss": 0.3124755024909973,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.12911168927708605,
      "grad_norm": 0.39783740043640137,
      "learning_rate": 8.814880572492043e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.02833021990954876,
      "mae_dx": 0.010446867905557156,
      "mae_dy": 0.004401807207614183,
      "pose_mae_dtheta": 0.19903676211833954,
      "pose_mae_dx": 0.07930503040552139,
      "pose_mae_dy": 0.04190331697463989,
      "pose_rmse_dtheta": 0.3580312132835388,
      "pose_rmse_dx": 0.17505128681659698,
      "pose_rmse_dy": 0.09483972191810608,
      "pose_rmse_mean": 0.20930740237236023,
      "rmse_dtheta": 0.04540685564279556,
      "rmse_dx": 0.022053468972444534,
      "rmse_dy": 0.008197449147701263,
      "rmse_mean": 0.025219259783625603,
      "rotation_flip": 0.013642564415931702,
      "sparse_tokens": 11433.0,
      "step": 2779,
      "turn_loss": 0.2508491575717926,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.12915814904292883,
      "grad_norm": 0.4830189645290375,
      "learning_rate": 8.81402572139505e-06,
      "loss": 0.1427,
      "mae_dtheta": 0.029302317649126053,
      "mae_dx": 0.008111929520964622,
      "mae_dy": 0.004907763097435236,
      "pose_mae_dtheta": 0.2478807121515274,
      "pose_mae_dx": 0.08048189431428909,
      "pose_mae_dy": 0.08429058641195297,
      "pose_rmse_dtheta": 0.4285154342651367,
      "pose_rmse_dx": 0.17701669037342072,
      "pose_rmse_dy": 0.1852569282054901,
      "pose_rmse_mean": 0.2635963559150696,
      "rmse_dtheta": 0.04548686742782593,
      "rmse_dx": 0.01968519762158394,
      "rmse_dy": 0.008651133626699448,
      "rmse_mean": 0.024607732892036438,
      "rotation_flip": 0.007936508394777775,
      "sparse_tokens": 14983.0,
      "step": 2780,
      "turn_loss": 0.1915813684463501,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.1292046088087716,
      "grad_norm": 0.552821159362793,
      "learning_rate": 8.81317060358119e-06,
      "loss": 0.1674,
      "mae_dtheta": 0.03496553376317024,
      "mae_dx": 0.016200395300984383,
      "mae_dy": 0.004359951242804527,
      "pose_mae_dtheta": 0.27801766991615295,
      "pose_mae_dx": 0.12995180487632751,
      "pose_mae_dy": 0.06842990219593048,
      "pose_rmse_dtheta": 0.47376853227615356,
      "pose_rmse_dx": 0.27077433466911316,
      "pose_rmse_dy": 0.1578942835330963,
      "pose_rmse_mean": 0.30081236362457275,
      "rmse_dtheta": 0.051454097032547,
      "rmse_dx": 0.02960425242781639,
      "rmse_dy": 0.008120160549879074,
      "rmse_mean": 0.029726173728704453,
      "rotation_flip": 0.015457788482308388,
      "sparse_tokens": 14919.0,
      "step": 2781,
      "turn_loss": 0.27130407094955444,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12925106857461438,
      "grad_norm": 0.6016042828559875,
      "learning_rate": 8.812315219110266e-06,
      "loss": 0.0945,
      "mae_dtheta": 0.011145171709358692,
      "mae_dx": 0.0019449457759037614,
      "mae_dy": 0.0019771053921431303,
      "pose_mae_dtheta": 0.08133602142333984,
      "pose_mae_dx": 0.021513191983103752,
      "pose_mae_dy": 0.02659282088279724,
      "pose_rmse_dtheta": 0.21841348707675934,
      "pose_rmse_dx": 0.05496634170413017,
      "pose_rmse_dy": 0.061900071799755096,
      "pose_rmse_mean": 0.1117599755525589,
      "rmse_dtheta": 0.026029134169220924,
      "rmse_dx": 0.006317737512290478,
      "rmse_dy": 0.005583120044320822,
      "rmse_mean": 0.012643329799175262,
      "rotation_flip": 0.0017301038606092334,
      "sparse_tokens": 32089.0,
      "step": 2782,
      "turn_loss": 0.08455032110214233,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12929752834045716,
      "grad_norm": 0.36158108711242676,
      "learning_rate": 8.811459568042092e-06,
      "loss": 0.0877,
      "mae_dtheta": 0.007942632772028446,
      "mae_dx": 0.001415407401509583,
      "mae_dy": 0.0019170198356732726,
      "pose_mae_dtheta": 0.05818191543221474,
      "pose_mae_dx": 0.020677147433161736,
      "pose_mae_dy": 0.025796078145503998,
      "pose_rmse_dtheta": 0.16114336252212524,
      "pose_rmse_dx": 0.05273355916142464,
      "pose_rmse_dy": 0.06822644919157028,
      "pose_rmse_mean": 0.09403445571660995,
      "rmse_dtheta": 0.019612306728959084,
      "rmse_dx": 0.004166535101830959,
      "rmse_dy": 0.004647532012313604,
      "rmse_mean": 0.009475458413362503,
      "rotation_flip": 0.0,
      "sparse_tokens": 32089.0,
      "step": 2783,
      "turn_loss": 0.06982207298278809,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.12934398810629993,
      "grad_norm": 0.533875048160553,
      "learning_rate": 8.810603650436502e-06,
      "loss": 0.1567,
      "mae_dtheta": 0.031457334756851196,
      "mae_dx": 0.0117486035451293,
      "mae_dy": 0.004779847338795662,
      "pose_mae_dtheta": 0.25187987089157104,
      "pose_mae_dx": 0.0904330164194107,
      "pose_mae_dy": 0.053562890738248825,
      "pose_rmse_dtheta": 0.470501571893692,
      "pose_rmse_dx": 0.2082696110010147,
      "pose_rmse_dy": 0.125750333070755,
      "pose_rmse_mean": 0.26817387342453003,
      "rmse_dtheta": 0.05027546361088753,
      "rmse_dx": 0.023733293637633324,
      "rmse_dy": 0.008339529857039452,
      "rmse_mean": 0.027449429035186768,
      "rotation_flip": 0.006000000052154064,
      "sparse_tokens": 8963.0,
      "step": 2784,
      "turn_loss": 0.2794329822063446,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.1293904478721427,
      "grad_norm": 0.5332491993904114,
      "learning_rate": 8.809747466353356e-06,
      "loss": 0.0933,
      "mae_dtheta": 0.035787709057331085,
      "mae_dx": 0.009186484850943089,
      "mae_dy": 0.005528079345822334,
      "pose_mae_dtheta": 0.25095510482788086,
      "pose_mae_dx": 0.08494354039430618,
      "pose_mae_dy": 0.07175904512405396,
      "pose_rmse_dtheta": 0.4727261960506439,
      "pose_rmse_dx": 0.20451125502586365,
      "pose_rmse_dy": 0.16100409626960754,
      "pose_rmse_mean": 0.2794138789176941,
      "rmse_dtheta": 0.054907653480768204,
      "rmse_dx": 0.021724220365285873,
      "rmse_dy": 0.010310719721019268,
      "rmse_mean": 0.028980864211916924,
      "rotation_flip": 0.008528784848749638,
      "sparse_tokens": 9298.0,
      "step": 2785,
      "turn_loss": 0.28636598587036133,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.12943690763798552,
      "grad_norm": 0.4083205461502075,
      "learning_rate": 8.808891015852523e-06,
      "loss": 0.1423,
      "mae_dtheta": 0.011519037187099457,
      "mae_dx": 0.0015735786873847246,
      "mae_dy": 0.002664609346538782,
      "pose_mae_dtheta": 0.07455197721719742,
      "pose_mae_dx": 0.02490713819861412,
      "pose_mae_dy": 0.035379551351070404,
      "pose_rmse_dtheta": 0.14909139275550842,
      "pose_rmse_dx": 0.06798797100782394,
      "pose_rmse_dy": 0.07530000060796738,
      "pose_rmse_mean": 0.09745979309082031,
      "rmse_dtheta": 0.021648991852998734,
      "rmse_dx": 0.005458115600049496,
      "rmse_dy": 0.006261213682591915,
      "rmse_mean": 0.011122774332761765,
      "rotation_flip": 0.004658385179936886,
      "sparse_tokens": 32073.0,
      "step": 2786,
      "turn_loss": 0.1087472215294838,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.1294833674038283,
      "grad_norm": 0.5656513571739197,
      "learning_rate": 8.808034298993896e-06,
      "loss": 0.1649,
      "mae_dtheta": 0.0314658060669899,
      "mae_dx": 0.01157186646014452,
      "mae_dy": 0.0031408858485519886,
      "pose_mae_dtheta": 0.2225794792175293,
      "pose_mae_dx": 0.09369213134050369,
      "pose_mae_dy": 0.03725787624716759,
      "pose_rmse_dtheta": 0.4527106285095215,
      "pose_rmse_dx": 0.2152971774339676,
      "pose_rmse_dy": 0.07351772487163544,
      "pose_rmse_mean": 0.2471751868724823,
      "rmse_dtheta": 0.050839077681303024,
      "rmse_dx": 0.025070197880268097,
      "rmse_dy": 0.006313499063253403,
      "rmse_mean": 0.02740759216248989,
      "rotation_flip": 0.021645022556185722,
      "sparse_tokens": 8106.0,
      "step": 2787,
      "turn_loss": 0.23951445519924164,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.12952982716967107,
      "grad_norm": 1.6314393281936646,
      "learning_rate": 8.80717731583739e-06,
      "loss": 0.268,
      "mae_dtheta": 0.0445052869617939,
      "mae_dx": 0.018440425395965576,
      "mae_dy": 0.0041905539110302925,
      "pose_mae_dtheta": 0.3823719024658203,
      "pose_mae_dx": 0.1444605439901352,
      "pose_mae_dy": 0.06884981691837311,
      "pose_rmse_dtheta": 0.6095054745674133,
      "pose_rmse_dx": 0.32638582587242126,
      "pose_rmse_dy": 0.190193772315979,
      "pose_rmse_mean": 0.37536168098449707,
      "rmse_dtheta": 0.06173103675246239,
      "rmse_dx": 0.034934721887111664,
      "rmse_dy": 0.009083283133804798,
      "rmse_mean": 0.035249680280685425,
      "rotation_flip": 0.00712589081376791,
      "sparse_tokens": 7200.0,
      "step": 2788,
      "turn_loss": 0.3064265549182892,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12957628693551385,
      "grad_norm": 0.47698867321014404,
      "learning_rate": 8.806320066442928e-06,
      "loss": 0.143,
      "mae_dtheta": 0.009144064970314503,
      "mae_dx": 0.0019973162561655045,
      "mae_dy": 0.002895395504310727,
      "pose_mae_dtheta": 0.06043248996138573,
      "pose_mae_dx": 0.025014474987983704,
      "pose_mae_dy": 0.026356562972068787,
      "pose_rmse_dtheta": 0.12701989710330963,
      "pose_rmse_dx": 0.06120298057794571,
      "pose_rmse_dy": 0.05687515065073967,
      "pose_rmse_mean": 0.08169934898614883,
      "rmse_dtheta": 0.018276866525411606,
      "rmse_dx": 0.005072966683655977,
      "rmse_dy": 0.006348849274218082,
      "rmse_mean": 0.009899560362100601,
      "rotation_flip": 0.003941663540899754,
      "sparse_tokens": 32089.0,
      "step": 2789,
      "turn_loss": 0.0873226597905159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.12962274670135662,
      "grad_norm": 0.4688316285610199,
      "learning_rate": 8.805462550870462e-06,
      "loss": 0.1389,
      "mae_dtheta": 0.0092335669323802,
      "mae_dx": 0.0010992991738021374,
      "mae_dy": 0.0014259411254897714,
      "pose_mae_dtheta": 0.06559327989816666,
      "pose_mae_dx": 0.01274486631155014,
      "pose_mae_dy": 0.02201133221387863,
      "pose_rmse_dtheta": 0.1987914890050888,
      "pose_rmse_dx": 0.03401089459657669,
      "pose_rmse_dy": 0.04979043826460838,
      "pose_rmse_mean": 0.09419761598110199,
      "rmse_dtheta": 0.0241071954369545,
      "rmse_dx": 0.003792513394728303,
      "rmse_dy": 0.002952011302113533,
      "rmse_mean": 0.010283906944096088,
      "rotation_flip": 0.004511278122663498,
      "sparse_tokens": 32057.0,
      "step": 2790,
      "turn_loss": 0.06727012246847153,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1296692064671994,
      "grad_norm": 0.4698808789253235,
      "learning_rate": 8.804604769179958e-06,
      "loss": 0.0975,
      "mae_dtheta": 0.006656785029917955,
      "mae_dx": 0.000927409331779927,
      "mae_dy": 0.001525516388937831,
      "pose_mae_dtheta": 0.04300573840737343,
      "pose_mae_dx": 0.013960674405097961,
      "pose_mae_dy": 0.020701751112937927,
      "pose_rmse_dtheta": 0.09042025357484818,
      "pose_rmse_dx": 0.0344206839799881,
      "pose_rmse_dy": 0.05261819064617157,
      "pose_rmse_mean": 0.05915304273366928,
      "rmse_dtheta": 0.014342003501951694,
      "rmse_dx": 0.0027648075483739376,
      "rmse_dy": 0.003399030538275838,
      "rmse_mean": 0.006835280917584896,
      "rotation_flip": 0.002805049065500498,
      "sparse_tokens": 32057.0,
      "step": 2791,
      "turn_loss": 0.05401967838406563,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.12971566623304218,
      "grad_norm": 0.45863503217697144,
      "learning_rate": 8.8037467214314e-06,
      "loss": 0.1099,
      "mae_dtheta": 0.03521545231342316,
      "mae_dx": 0.013682905584573746,
      "mae_dy": 0.004425455816090107,
      "pose_mae_dtheta": 0.2713763117790222,
      "pose_mae_dx": 0.100125253200531,
      "pose_mae_dy": 0.06113620847463608,
      "pose_rmse_dtheta": 0.5048699975013733,
      "pose_rmse_dx": 0.23408587276935577,
      "pose_rmse_dy": 0.14694161713123322,
      "pose_rmse_mean": 0.2952991724014282,
      "rmse_dtheta": 0.05419148504734039,
      "rmse_dx": 0.02688160166144371,
      "rmse_dy": 0.009158839471638203,
      "rmse_mean": 0.030077312141656876,
      "rotation_flip": 0.009155645966529846,
      "sparse_tokens": 15754.0,
      "step": 2792,
      "turn_loss": 0.25594159960746765,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.12976212599888495,
      "grad_norm": 0.47720658779144287,
      "learning_rate": 8.802888407684791e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.012198139913380146,
      "mae_dx": 0.0022003536578267813,
      "mae_dy": 0.0035988299641758204,
      "pose_mae_dtheta": 0.08691955357789993,
      "pose_mae_dx": 0.03164356201887131,
      "pose_mae_dy": 0.043109092861413956,
      "pose_rmse_dtheta": 0.17532187700271606,
      "pose_rmse_dx": 0.07076253741979599,
      "pose_rmse_dy": 0.10142261534929276,
      "pose_rmse_mean": 0.11583568155765533,
      "rmse_dtheta": 0.02204660326242447,
      "rmse_dx": 0.00560249388217926,
      "rmse_dy": 0.0071415649726986885,
      "rmse_mean": 0.01159688737243414,
      "rotation_flip": 0.004417261108756065,
      "sparse_tokens": 32089.0,
      "step": 2793,
      "turn_loss": 0.09920787066221237,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16512.0,
      "epoch": 0.12980858576472776,
      "grad_norm": 0.4624859094619751,
      "learning_rate": 8.802029828000157e-06,
      "loss": 0.1248,
      "mae_dtheta": 0.030051684007048607,
      "mae_dx": 0.009917028248310089,
      "mae_dy": 0.0037692077457904816,
      "pose_mae_dtheta": 0.19443389773368835,
      "pose_mae_dx": 0.08825556188821793,
      "pose_mae_dy": 0.044275879859924316,
      "pose_rmse_dtheta": 0.3666389286518097,
      "pose_rmse_dx": 0.22904692590236664,
      "pose_rmse_dy": 0.08478891849517822,
      "pose_rmse_mean": 0.22682492434978485,
      "rmse_dtheta": 0.04685717821121216,
      "rmse_dx": 0.021864302456378937,
      "rmse_dy": 0.007032012566924095,
      "rmse_mean": 0.02525116503238678,
      "rotation_flip": 0.011479591950774193,
      "sparse_tokens": 13567.0,
      "step": 2794,
      "turn_loss": 0.26392197608947754,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12985504553057053,
      "grad_norm": 0.5236494541168213,
      "learning_rate": 8.801170982437533e-06,
      "loss": 0.106,
      "mae_dtheta": 0.011015338823199272,
      "mae_dx": 0.0017363675870001316,
      "mae_dy": 0.0030082021839916706,
      "pose_mae_dtheta": 0.07688351720571518,
      "pose_mae_dx": 0.02995160222053528,
      "pose_mae_dy": 0.03767087683081627,
      "pose_rmse_dtheta": 0.18773068487644196,
      "pose_rmse_dx": 0.0732685774564743,
      "pose_rmse_dy": 0.08845911175012589,
      "pose_rmse_mean": 0.11648612469434738,
      "rmse_dtheta": 0.023397171869874,
      "rmse_dx": 0.0044136857613921165,
      "rmse_dy": 0.0070592728443443775,
      "rmse_mean": 0.011623376980423927,
      "rotation_flip": 0.002825856674462557,
      "sparse_tokens": 32105.0,
      "step": 2795,
      "turn_loss": 0.090652696788311,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.1299015052964133,
      "grad_norm": 0.6123028993606567,
      "learning_rate": 8.800311871056983e-06,
      "loss": 0.1441,
      "mae_dtheta": 0.01261935755610466,
      "mae_dx": 0.0016863320488482714,
      "mae_dy": 0.0026519771199673414,
      "pose_mae_dtheta": 0.0916399136185646,
      "pose_mae_dx": 0.02849603071808815,
      "pose_mae_dy": 0.035472769290208817,
      "pose_rmse_dtheta": 0.2495879977941513,
      "pose_rmse_dx": 0.08441831171512604,
      "pose_rmse_dy": 0.08503863215446472,
      "pose_rmse_mean": 0.1396816521883011,
      "rmse_dtheta": 0.02849196456372738,
      "rmse_dx": 0.005598784890025854,
      "rmse_dy": 0.0067857555113732815,
      "rmse_mean": 0.013625501655042171,
      "rotation_flip": 0.005061155650764704,
      "sparse_tokens": 32041.0,
      "step": 2796,
      "turn_loss": 0.0931597426533699,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.1299479650622561,
      "grad_norm": 1.016448736190796,
      "learning_rate": 8.799452493918586e-06,
      "loss": 0.2872,
      "mae_dtheta": 0.034953467547893524,
      "mae_dx": 0.01756252348423004,
      "mae_dy": 0.00837866123765707,
      "pose_mae_dtheta": 0.27142396569252014,
      "pose_mae_dx": 0.16338035464286804,
      "pose_mae_dy": 0.09438011050224304,
      "pose_rmse_dtheta": 0.47094395756721497,
      "pose_rmse_dx": 0.33165600895881653,
      "pose_rmse_dy": 0.1666705310344696,
      "pose_rmse_mean": 0.32309016585350037,
      "rmse_dtheta": 0.05128338932991028,
      "rmse_dx": 0.03169805929064751,
      "rmse_dy": 0.014618840999901295,
      "rmse_mean": 0.0325334332883358,
      "rotation_flip": 0.00486223679035902,
      "sparse_tokens": 10928.0,
      "step": 2797,
      "turn_loss": 0.3373592793941498,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.12999442482809886,
      "grad_norm": 0.35865113139152527,
      "learning_rate": 8.798592851082434e-06,
      "loss": 0.0967,
      "mae_dtheta": 0.010040592402219772,
      "mae_dx": 0.0020269516389817,
      "mae_dy": 0.0027282019145786762,
      "pose_mae_dtheta": 0.06126154214143753,
      "pose_mae_dx": 0.026718946173787117,
      "pose_mae_dy": 0.030717168003320694,
      "pose_rmse_dtheta": 0.11288369446992874,
      "pose_rmse_dx": 0.06355267018079758,
      "pose_rmse_dy": 0.06587304174900055,
      "pose_rmse_mean": 0.08076980710029602,
      "rmse_dtheta": 0.01841268502175808,
      "rmse_dx": 0.005589351523667574,
      "rmse_dy": 0.005395369604229927,
      "rmse_mean": 0.009799135848879814,
      "rotation_flip": 0.0041222949512302876,
      "sparse_tokens": 32105.0,
      "step": 2798,
      "turn_loss": 0.08736150711774826,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.13004088459394164,
      "grad_norm": 1.6270027160644531,
      "learning_rate": 8.797732942608648e-06,
      "loss": 0.2586,
      "mae_dtheta": 0.029499348253011703,
      "mae_dx": 0.008328739553689957,
      "mae_dy": 0.0036634921561926603,
      "pose_mae_dtheta": 0.23731134831905365,
      "pose_mae_dx": 0.08798079937696457,
      "pose_mae_dy": 0.04999003931879997,
      "pose_rmse_dtheta": 0.4360142946243286,
      "pose_rmse_dx": 0.21784047782421112,
      "pose_rmse_dy": 0.11666851490736008,
      "pose_rmse_mean": 0.25684112310409546,
      "rmse_dtheta": 0.046451669186353683,
      "rmse_dx": 0.020022135227918625,
      "rmse_dy": 0.006928459275513887,
      "rmse_mean": 0.02446742169559002,
      "rotation_flip": 0.02310924418270588,
      "sparse_tokens": 8017.0,
      "step": 2799,
      "turn_loss": 0.2107614427804947,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.13008734435978442,
      "grad_norm": 0.7436358332633972,
      "learning_rate": 8.796872768557358e-06,
      "loss": 0.1285,
      "mae_dtheta": 0.027715371921658516,
      "mae_dx": 0.01872199773788452,
      "mae_dy": 0.0043653808534145355,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7436358332633972,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 133.9437255859375,
      "model/head/act_norm_mean": 109.24332682291667,
      "model/head/act_norm_min": 79.09986114501953,
      "model/head/act_over_embed": 75.07303694484777,
      "model/head/grad_frac": 0.0840270072221756,
      "model/head/grad_norm": 0.06248549371957779,
      "model/head/grad_zero_frac": 0.00016276042151730508,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6888950892857143,
      "model/head/update_ratio": 0.0010794107802212238,
      "model/head/weight_delta": 6.173647403717041,
      "model/head/weight_delta_rel": 0.10830406099557877,
      "model/head/weight_norm": 57.88852310180664,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41561296582221985,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41561296582221985,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41561296582221985,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2856131211429197,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11435973644256592,
      "model/modality_embedder.encoders.pose/grad_norm": 0.08504199981689453,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002760334638878703,
      "model/modality_embedder.encoders.pose/weight_delta": 2.0217576026916504,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06605712324380875,
      "model/modality_embedder.encoders.pose/weight_norm": 30.808582305908203,
      "model/modality_embedder/grad_frac": 0.11435973644256592,
      "model/modality_embedder/grad_norm": 0.08504199981689453,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.002760334638878703,
      "model/modality_embedder/weight_delta": 2.0217576026916504,
      "model/modality_embedder/weight_delta_rel": 0.06605712324380875,
      "model/modality_embedder/weight_norm": 30.808582305908203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 69.72514343261719,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.412847517479214,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.309065818786621,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.089528008543642,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07106039673089981,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05284305661916733,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.00191000837367028,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.331139326095581,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04850751906633377,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.666400909423828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 70.47714233398438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.271603954081634,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.757006645202637,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.679673471581253,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06789474934339523,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.050488971173763275,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017248524818569422,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.6678663492202759,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05777619406580925,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.271472930908203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 72.70089721679688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.96166087962963,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.397397994995117,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.84109641338006,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07427538931369781,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05523383989930153,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018281028605997562,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.7877389192581177,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06002892553806305,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.213748931884766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 72.66854858398438,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.936017809901738,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.44349193572998,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.197892980083857,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09200930595397949,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06842141598463058,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0023137766402214766,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.5238465070724487,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05207784101366997,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.571313858032227,
      "model/normalizer/grad_frac": 0.33508288860321045,
      "model/normalizer/grad_norm": 0.2491796463727951,
      "model/normalizer/grad_zero_frac": 0.0001559894735692069,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0031906093936413527,
      "model/normalizer/weight_delta": 3.24875807762146,
      "model/normalizer/weight_delta_rel": 0.04184212163090706,
      "model/normalizer/weight_norm": 78.09782409667969,
      "pose_mae_dtheta": 0.19411320984363556,
      "pose_mae_dx": 0.14738455414772034,
      "pose_mae_dy": 0.05827818438410759,
      "pose_rmse_dtheta": 0.3983765244483948,
      "pose_rmse_dx": 0.32136601209640503,
      "pose_rmse_dy": 0.1177840381860733,
      "pose_rmse_mean": 0.2791755199432373,
      "rmse_dtheta": 0.046982407569885254,
      "rmse_dx": 0.03309467434883118,
      "rmse_dy": 0.007558469660580158,
      "rmse_mean": 0.029211852699518204,
      "rotation_flip": 0.02950819581747055,
      "sparse_tokens": 5911.0,
      "step": 2800,
      "turn_loss": 0.23198184370994568,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "epoch": 0.13008734435978442,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31912702322006226,
      "eval_objectnav_nopose_mae_dtheta": 0.042982060462236404,
      "eval_objectnav_nopose_mae_dx": 0.01440365519374609,
      "eval_objectnav_nopose_mae_dy": 0.004806002136319876,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3530901372432709,
      "eval_objectnav_nopose_pose_mae_dx": 0.11865435540676117,
      "eval_objectnav_nopose_pose_mae_dy": 0.054119840264320374,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5830326676368713,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2534938156604767,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12668943405151367,
      "eval_objectnav_nopose_pose_rmse_mean": 0.321071982383728,
      "eval_objectnav_nopose_rmse_dtheta": 0.06099753454327583,
      "eval_objectnav_nopose_rmse_dx": 0.02748585119843483,
      "eval_objectnav_nopose_rmse_dy": 0.009744780138134956,
      "eval_objectnav_nopose_rmse_mean": 0.03274272382259369,
      "eval_objectnav_nopose_rotation_flip": 0.013848656788468361,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31912702322006226,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 2800
    },
    {
      "epoch": 0.13008734435978442,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2875354290008545,
      "eval_objectnav_pose_mae_dtheta": 0.037911441177129745,
      "eval_objectnav_pose_mae_dx": 0.011954751797020435,
      "eval_objectnav_pose_mae_dy": 0.0045119174756109715,
      "eval_objectnav_pose_pose_mae_dtheta": 0.29333364963531494,
      "eval_objectnav_pose_pose_mae_dx": 0.09449999779462814,
      "eval_objectnav_pose_pose_mae_dy": 0.04834432154893875,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5121446251869202,
      "eval_objectnav_pose_pose_rmse_dx": 0.213933065533638,
      "eval_objectnav_pose_pose_rmse_dy": 0.11627060920000076,
      "eval_objectnav_pose_pose_rmse_mean": 0.2807827591896057,
      "eval_objectnav_pose_rmse_dtheta": 0.05615606531500816,
      "eval_objectnav_pose_rmse_dx": 0.0243948046118021,
      "eval_objectnav_pose_rmse_dy": 0.00941726565361023,
      "eval_objectnav_pose_rmse_mean": 0.02998938038945198,
      "eval_objectnav_pose_rotation_flip": 0.014345475472509861,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2875354290008545,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 2800
    },
    {
      "epoch": 0.13008734435978442,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10454994440078735,
      "eval_pointnav_mae_dtheta": 0.011975778266787529,
      "eval_pointnav_mae_dx": 0.0030720147769898176,
      "eval_pointnav_mae_dy": 0.0027036936953663826,
      "eval_pointnav_pose_mae_dtheta": 0.08609567582607269,
      "eval_pointnav_pose_mae_dx": 0.03400728106498718,
      "eval_pointnav_pose_mae_dy": 0.030001336708664894,
      "eval_pointnav_pose_rmse_dtheta": 0.227225199341774,
      "eval_pointnav_pose_rmse_dx": 0.09489768743515015,
      "eval_pointnav_pose_rmse_dy": 0.08705683052539825,
      "eval_pointnav_pose_rmse_mean": 0.1363932341337204,
      "eval_pointnav_rmse_dtheta": 0.027385970577597618,
      "eval_pointnav_rmse_dx": 0.00903957337141037,
      "eval_pointnav_rmse_dy": 0.007130975369364023,
      "eval_pointnav_rmse_mean": 0.014518841169774532,
      "eval_pointnav_rotation_flip": 0.005580649711191654,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10454994440078735,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 2800
    },
    {
      "epoch": 0.13008734435978442,
      "eval_loss": 0.23707079887390137,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31912702322006226,
      "eval_objectnav_nopose_mae_dtheta": 0.042982060462236404,
      "eval_objectnav_nopose_mae_dx": 0.01440365519374609,
      "eval_objectnav_nopose_mae_dy": 0.004806002136319876,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3530901372432709,
      "eval_objectnav_nopose_pose_mae_dx": 0.11865435540676117,
      "eval_objectnav_nopose_pose_mae_dy": 0.054119840264320374,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5830326676368713,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2534938156604767,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12668943405151367,
      "eval_objectnav_nopose_pose_rmse_mean": 0.321071982383728,
      "eval_objectnav_nopose_rmse_dtheta": 0.06099753454327583,
      "eval_objectnav_nopose_rmse_dx": 0.02748585119843483,
      "eval_objectnav_nopose_rmse_dy": 0.009744780138134956,
      "eval_objectnav_nopose_rmse_mean": 0.03274272382259369,
      "eval_objectnav_nopose_rotation_flip": 0.013848656788468361,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31912702322006226,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2875354290008545,
      "eval_objectnav_pose_mae_dtheta": 0.037911441177129745,
      "eval_objectnav_pose_mae_dx": 0.011954751797020435,
      "eval_objectnav_pose_mae_dy": 0.0045119174756109715,
      "eval_objectnav_pose_pose_mae_dtheta": 0.29333364963531494,
      "eval_objectnav_pose_pose_mae_dx": 0.09449999779462814,
      "eval_objectnav_pose_pose_mae_dy": 0.04834432154893875,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.5121446251869202,
      "eval_objectnav_pose_pose_rmse_dx": 0.213933065533638,
      "eval_objectnav_pose_pose_rmse_dy": 0.11627060920000076,
      "eval_objectnav_pose_pose_rmse_mean": 0.2807827591896057,
      "eval_objectnav_pose_rmse_dtheta": 0.05615606531500816,
      "eval_objectnav_pose_rmse_dx": 0.0243948046118021,
      "eval_objectnav_pose_rmse_dy": 0.00941726565361023,
      "eval_objectnav_pose_rmse_mean": 0.02998938038945198,
      "eval_objectnav_pose_rotation_flip": 0.014345475472509861,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2875354290008545,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10454994440078735,
      "eval_pointnav_mae_dtheta": 0.011975778266787529,
      "eval_pointnav_mae_dx": 0.0030720147769898176,
      "eval_pointnav_mae_dy": 0.0027036936953663826,
      "eval_pointnav_pose_mae_dtheta": 0.08609567582607269,
      "eval_pointnav_pose_mae_dx": 0.03400728106498718,
      "eval_pointnav_pose_mae_dy": 0.030001336708664894,
      "eval_pointnav_pose_rmse_dtheta": 0.227225199341774,
      "eval_pointnav_pose_rmse_dx": 0.09489768743515015,
      "eval_pointnav_pose_rmse_dy": 0.08705683052539825,
      "eval_pointnav_pose_rmse_mean": 0.1363932341337204,
      "eval_pointnav_rmse_dtheta": 0.027385970577597618,
      "eval_pointnav_rmse_dx": 0.00903957337141037,
      "eval_pointnav_rmse_dy": 0.007130975369364023,
      "eval_pointnav_rmse_mean": 0.014518841169774532,
      "eval_pointnav_rotation_flip": 0.005580649711191654,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10454994440078735,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 2800
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.1301338041256272,
      "grad_norm": 0.6830317974090576,
      "learning_rate": 8.796012328988716e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.023337900638580322,
      "mae_dx": 0.003044374054297805,
      "mae_dy": 0.0030922815203666687,
      "pose_mae_dtheta": 0.17126736044883728,
      "pose_mae_dx": 0.029446857050061226,
      "pose_mae_dy": 0.05024419724941254,
      "pose_rmse_dtheta": 0.31845352053642273,
      "pose_rmse_dx": 0.053821906447410583,
      "pose_rmse_dy": 0.10231214761734009,
      "pose_rmse_mean": 0.1581958532333374,
      "rmse_dtheta": 0.03865967318415642,
      "rmse_dx": 0.007387908175587654,
      "rmse_dy": 0.005074179265648127,
      "rmse_mean": 0.017040587961673737,
      "rotation_flip": 0.0,
      "sparse_tokens": 3614.0,
      "step": 2801,
      "turn_loss": 0.19847479462623596,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.13018026389147,
      "grad_norm": 0.4731055498123169,
      "learning_rate": 8.795151623962897e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.013282906264066696,
      "mae_dx": 0.0027445494197309017,
      "mae_dy": 0.002495583612471819,
      "pose_mae_dtheta": 0.09504588693380356,
      "pose_mae_dx": 0.03155820071697235,
      "pose_mae_dy": 0.035716462880373,
      "pose_rmse_dtheta": 0.25604599714279175,
      "pose_rmse_dx": 0.0780002772808075,
      "pose_rmse_dy": 0.08786731958389282,
      "pose_rmse_mean": 0.14063787460327148,
      "rmse_dtheta": 0.028863990679383278,
      "rmse_dx": 0.008758465759456158,
      "rmse_dy": 0.005726724863052368,
      "rmse_mean": 0.014449726790189743,
      "rotation_flip": 0.002097315387800336,
      "sparse_tokens": 32073.0,
      "step": 2802,
      "turn_loss": 0.12251881510019302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.13022672365731278,
      "grad_norm": 2.0046212673187256,
      "learning_rate": 8.794290653540086e-06,
      "loss": 0.2661,
      "mae_dtheta": 0.04912147298455238,
      "mae_dx": 0.0221793744713068,
      "mae_dy": 0.00488618016242981,
      "pose_mae_dtheta": 0.4229799509048462,
      "pose_mae_dx": 0.20846088230609894,
      "pose_mae_dy": 0.07625963538885117,
      "pose_rmse_dtheta": 0.6459917426109314,
      "pose_rmse_dx": 0.3915558159351349,
      "pose_rmse_dy": 0.18255750834941864,
      "pose_rmse_mean": 0.4067016839981079,
      "rmse_dtheta": 0.06604532897472382,
      "rmse_dx": 0.037401724606752396,
      "rmse_dy": 0.009383301250636578,
      "rmse_mean": 0.037610117346048355,
      "rotation_flip": 0.017281105741858482,
      "sparse_tokens": 14480.0,
      "step": 2803,
      "turn_loss": 0.3015185296535492,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.13027318342315555,
      "grad_norm": 0.5323091149330139,
      "learning_rate": 8.793429417780494e-06,
      "loss": 0.104,
      "mae_dtheta": 0.013168958015739918,
      "mae_dx": 0.0028584133833646774,
      "mae_dy": 0.0035358050372451544,
      "pose_mae_dtheta": 0.09278176724910736,
      "pose_mae_dx": 0.03436214104294777,
      "pose_mae_dy": 0.03237772732973099,
      "pose_rmse_dtheta": 0.23022550344467163,
      "pose_rmse_dx": 0.09560523182153702,
      "pose_rmse_dy": 0.07853904366493225,
      "pose_rmse_mean": 0.13478992879390717,
      "rmse_dtheta": 0.027969321236014366,
      "rmse_dx": 0.008635263890028,
      "rmse_dy": 0.008351997472345829,
      "rmse_mean": 0.014985526911914349,
      "rotation_flip": 0.004629629664123058,
      "sparse_tokens": 32073.0,
      "step": 2804,
      "turn_loss": 0.10552497953176498,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.13031964318899833,
      "grad_norm": 0.7615020871162415,
      "learning_rate": 8.792567916744346e-06,
      "loss": 0.1319,
      "mae_dtheta": 0.010846076533198357,
      "mae_dx": 0.0022754629608243704,
      "mae_dy": 0.0026060310192406178,
      "pose_mae_dtheta": 0.0673808678984642,
      "pose_mae_dx": 0.026025153696537018,
      "pose_mae_dy": 0.029665429145097733,
      "pose_rmse_dtheta": 0.14768895506858826,
      "pose_rmse_dx": 0.07525324821472168,
      "pose_rmse_dy": 0.08468758314847946,
      "pose_rmse_mean": 0.10254326462745667,
      "rmse_dtheta": 0.02203385718166828,
      "rmse_dx": 0.006846718490123749,
      "rmse_dy": 0.007074373308569193,
      "rmse_mean": 0.011984983459115028,
      "rotation_flip": 0.0048436811193823814,
      "sparse_tokens": 32121.0,
      "step": 2805,
      "turn_loss": 0.10375015437602997,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15269.0,
      "epoch": 0.1303661029548411,
      "grad_norm": 0.6580604314804077,
      "learning_rate": 8.791706150491887e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.02771793119609356,
      "mae_dx": 0.01201281975954771,
      "mae_dy": 0.0045287273824214935,
      "pose_mae_dtheta": 0.19896762073040009,
      "pose_mae_dx": 0.09874407202005386,
      "pose_mae_dy": 0.058476246893405914,
      "pose_rmse_dtheta": 0.325890451669693,
      "pose_rmse_dx": 0.2141074538230896,
      "pose_rmse_dy": 0.12558171153068542,
      "pose_rmse_mean": 0.2218599021434784,
      "rmse_dtheta": 0.04091215878725052,
      "rmse_dx": 0.023724814876914024,
      "rmse_dy": 0.008255409076809883,
      "rmse_mean": 0.024297460913658142,
      "rotation_flip": 0.01304347813129425,
      "sparse_tokens": 12133.0,
      "step": 2806,
      "turn_loss": 0.23867018520832062,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.13041256272068388,
      "grad_norm": 0.5931985378265381,
      "learning_rate": 8.790844119083384e-06,
      "loss": 0.1763,
      "mae_dtheta": 0.0408988781273365,
      "mae_dx": 0.009114447049796581,
      "mae_dy": 0.005309705622494221,
      "pose_mae_dtheta": 0.3257032632827759,
      "pose_mae_dx": 0.05709400027990341,
      "pose_mae_dy": 0.0519615076482296,
      "pose_rmse_dtheta": 0.614492654800415,
      "pose_rmse_dx": 0.11788158863782883,
      "pose_rmse_dy": 0.10342131555080414,
      "pose_rmse_mean": 0.2785985469818115,
      "rmse_dtheta": 0.06183850020170212,
      "rmse_dx": 0.020302755758166313,
      "rmse_dy": 0.009599903598427773,
      "rmse_mean": 0.030580386519432068,
      "rotation_flip": 0.012232416309416294,
      "sparse_tokens": 6562.0,
      "step": 2807,
      "turn_loss": 0.257628858089447,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.13045902248652666,
      "grad_norm": 0.4789378046989441,
      "learning_rate": 8.789981822579115e-06,
      "loss": 0.0938,
      "mae_dtheta": 0.013331085443496704,
      "mae_dx": 0.003556343261152506,
      "mae_dy": 0.003907970152795315,
      "pose_mae_dtheta": 0.10036145150661469,
      "pose_mae_dx": 0.03256870061159134,
      "pose_mae_dy": 0.03844152390956879,
      "pose_rmse_dtheta": 0.2482220083475113,
      "pose_rmse_dx": 0.09288933873176575,
      "pose_rmse_dy": 0.10256858915090561,
      "pose_rmse_mean": 0.14789332449436188,
      "rmse_dtheta": 0.028759879991412163,
      "rmse_dx": 0.011407054029405117,
      "rmse_dy": 0.010145068168640137,
      "rmse_mean": 0.01677066832780838,
      "rotation_flip": 0.004399999976158142,
      "sparse_tokens": 32057.0,
      "step": 2808,
      "turn_loss": 0.1329672783613205,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.13050548225236944,
      "grad_norm": 0.4147396385669708,
      "learning_rate": 8.789119261039385e-06,
      "loss": 0.0868,
      "mae_dtheta": 0.011558338068425655,
      "mae_dx": 0.001327170873992145,
      "mae_dy": 0.002449638210237026,
      "pose_mae_dtheta": 0.07280570268630981,
      "pose_mae_dx": 0.025028400123119354,
      "pose_mae_dy": 0.035285431891679764,
      "pose_rmse_dtheta": 0.14854547381401062,
      "pose_rmse_dx": 0.05880753695964813,
      "pose_rmse_dy": 0.07726871222257614,
      "pose_rmse_mean": 0.09487390518188477,
      "rmse_dtheta": 0.021939018741250038,
      "rmse_dx": 0.0036632372066378593,
      "rmse_dy": 0.004936780780553818,
      "rmse_mean": 0.010179678909480572,
      "rotation_flip": 0.005105762276798487,
      "sparse_tokens": 32041.0,
      "step": 2809,
      "turn_loss": 0.08097405731678009,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.13055194201821224,
      "grad_norm": 0.6765435338020325,
      "learning_rate": 8.78825643452451e-06,
      "loss": 0.1187,
      "mae_dtheta": 0.010684605687856674,
      "mae_dx": 0.003365162992849946,
      "mae_dy": 0.0037544211372733116,
      "pose_mae_dtheta": 0.07990920543670654,
      "pose_mae_dx": 0.03972091153264046,
      "pose_mae_dy": 0.03414762020111084,
      "pose_rmse_dtheta": 0.17730410397052765,
      "pose_rmse_dx": 0.10610449314117432,
      "pose_rmse_dy": 0.07755167782306671,
      "pose_rmse_mean": 0.12032008171081543,
      "rmse_dtheta": 0.020855052396655083,
      "rmse_dx": 0.00866325106471777,
      "rmse_dy": 0.0088506443426013,
      "rmse_mean": 0.0127896498888731,
      "rotation_flip": 0.005610098131000996,
      "sparse_tokens": 32121.0,
      "step": 2810,
      "turn_loss": 0.11259512603282928,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.13059840178405502,
      "grad_norm": 0.8444762229919434,
      "learning_rate": 8.78739334309483e-06,
      "loss": 0.1092,
      "mae_dtheta": 0.011900565586984158,
      "mae_dx": 0.0013471260899677873,
      "mae_dy": 0.0021787534933537245,
      "pose_mae_dtheta": 0.07308270037174225,
      "pose_mae_dx": 0.021336574107408524,
      "pose_mae_dy": 0.032430246472358704,
      "pose_rmse_dtheta": 0.13460764288902283,
      "pose_rmse_dx": 0.048194173723459244,
      "pose_rmse_dy": 0.07147720456123352,
      "pose_rmse_mean": 0.0847596749663353,
      "rmse_dtheta": 0.020472554489970207,
      "rmse_dx": 0.004162793513387442,
      "rmse_dy": 0.003918251488357782,
      "rmse_mean": 0.009517867118120193,
      "rotation_flip": 0.007912957109510899,
      "sparse_tokens": 32105.0,
      "step": 2811,
      "turn_loss": 0.09658487886190414,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.1306448615498978,
      "grad_norm": 0.5151438117027283,
      "learning_rate": 8.786529986810701e-06,
      "loss": 0.0964,
      "mae_dtheta": 0.034969035536050797,
      "mae_dx": 0.006976306904107332,
      "mae_dy": 0.0036554690450429916,
      "pose_mae_dtheta": 0.19616177678108215,
      "pose_mae_dx": 0.04260542243719101,
      "pose_mae_dy": 0.05273698642849922,
      "pose_rmse_dtheta": 0.3031174838542938,
      "pose_rmse_dx": 0.12833204865455627,
      "pose_rmse_dy": 0.12125520408153534,
      "pose_rmse_mean": 0.18423491716384888,
      "rmse_dtheta": 0.05294810235500336,
      "rmse_dx": 0.02037571743130684,
      "rmse_dy": 0.005547804292291403,
      "rmse_mean": 0.026290541514754295,
      "rotation_flip": 0.013333333656191826,
      "sparse_tokens": 2460.0,
      "step": 2812,
      "turn_loss": 0.1956399828195572,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.13069132131574057,
      "grad_norm": 0.8184679746627808,
      "learning_rate": 8.785666365732496e-06,
      "loss": 0.1426,
      "mae_dtheta": 0.03436638414859772,
      "mae_dx": 0.018234942108392715,
      "mae_dy": 0.008656595833599567,
      "pose_mae_dtheta": 0.2753732204437256,
      "pose_mae_dx": 0.13043542206287384,
      "pose_mae_dy": 0.07286740094423294,
      "pose_rmse_dtheta": 0.47348254919052124,
      "pose_rmse_dx": 0.23724691569805145,
      "pose_rmse_dy": 0.1346379518508911,
      "pose_rmse_mean": 0.2817891538143158,
      "rmse_dtheta": 0.04891254007816315,
      "rmse_dx": 0.030216237530112267,
      "rmse_dy": 0.015428101643919945,
      "rmse_mean": 0.03151896223425865,
      "rotation_flip": 0.013972056098282337,
      "sparse_tokens": 8991.0,
      "step": 2813,
      "turn_loss": 0.42460232973098755,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.13073778108158335,
      "grad_norm": 0.7779445052146912,
      "learning_rate": 8.78480247992061e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.03653794527053833,
      "mae_dx": 0.014712839387357235,
      "mae_dy": 0.00994893442839384,
      "pose_mae_dtheta": 0.2907210886478424,
      "pose_mae_dx": 0.13333283364772797,
      "pose_mae_dy": 0.11614108830690384,
      "pose_rmse_dtheta": 0.4898625910282135,
      "pose_rmse_dx": 0.25828009843826294,
      "pose_rmse_dy": 0.20770354568958282,
      "pose_rmse_mean": 0.3186154365539551,
      "rmse_dtheta": 0.05442514643073082,
      "rmse_dx": 0.02748500183224678,
      "rmse_dy": 0.01692686416208744,
      "rmse_mean": 0.0329456701874733,
      "rotation_flip": 0.017094017937779427,
      "sparse_tokens": 5507.0,
      "step": 2814,
      "turn_loss": 0.38167721033096313,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.13078424084742613,
      "grad_norm": 0.596553385257721,
      "learning_rate": 8.783938329435458e-06,
      "loss": 0.1548,
      "mae_dtheta": 0.01175686251372099,
      "mae_dx": 0.00449015386402607,
      "mae_dy": 0.0034176406916230917,
      "pose_mae_dtheta": 0.08180676400661469,
      "pose_mae_dx": 0.04268072172999382,
      "pose_mae_dy": 0.040478937327861786,
      "pose_rmse_dtheta": 0.20607207715511322,
      "pose_rmse_dx": 0.10406066477298737,
      "pose_rmse_dy": 0.1110324040055275,
      "pose_rmse_mean": 0.1403883844614029,
      "rmse_dtheta": 0.029898853972554207,
      "rmse_dx": 0.0113124530762434,
      "rmse_dy": 0.009199078194797039,
      "rmse_mean": 0.01680346205830574,
      "rotation_flip": 0.0029978586826473475,
      "sparse_tokens": 32169.0,
      "step": 2815,
      "turn_loss": 0.21808302402496338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26203.0,
      "epoch": 0.1308307006132689,
      "grad_norm": 0.7002831697463989,
      "learning_rate": 8.783073914337465e-06,
      "loss": 0.1334,
      "mae_dtheta": 0.034768883138895035,
      "mae_dx": 0.01170117687433958,
      "mae_dy": 0.007776142098009586,
      "pose_mae_dtheta": 0.2968422770500183,
      "pose_mae_dx": 0.10903282463550568,
      "pose_mae_dy": 0.10745369642972946,
      "pose_rmse_dtheta": 0.5421909689903259,
      "pose_rmse_dx": 0.2397228628396988,
      "pose_rmse_dy": 0.276833713054657,
      "pose_rmse_mean": 0.35291585326194763,
      "rmse_dtheta": 0.05414331704378128,
      "rmse_dx": 0.023592883720993996,
      "rmse_dy": 0.016931675374507904,
      "rmse_mean": 0.03155595809221268,
      "rotation_flip": 0.01493775937706232,
      "sparse_tokens": 20156.0,
      "step": 2816,
      "turn_loss": 0.3007245361804962,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.13087716037911168,
      "grad_norm": 0.49707749485969543,
      "learning_rate": 8.782209234687083e-06,
      "loss": 0.1349,
      "mae_dtheta": 0.031047390773892403,
      "mae_dx": 0.009549067355692387,
      "mae_dy": 0.0061600967310369015,
      "pose_mae_dtheta": 0.25209277868270874,
      "pose_mae_dx": 0.062038395553827286,
      "pose_mae_dy": 0.0793178454041481,
      "pose_rmse_dtheta": 0.4559151232242584,
      "pose_rmse_dx": 0.1476786881685257,
      "pose_rmse_dy": 0.17980355024337769,
      "pose_rmse_mean": 0.26113247871398926,
      "rmse_dtheta": 0.049131084233522415,
      "rmse_dx": 0.02102305367588997,
      "rmse_dy": 0.012848556973040104,
      "rmse_mean": 0.027667565271258354,
      "rotation_flip": 0.019498607143759727,
      "sparse_tokens": 12726.0,
      "step": 2817,
      "turn_loss": 0.2638876438140869,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.13092362014495446,
      "grad_norm": 0.5164492130279541,
      "learning_rate": 8.78134429054478e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.007240209262818098,
      "mae_dx": 0.00276228878647089,
      "mae_dy": 0.001216270262375474,
      "pose_mae_dtheta": 0.05198465287685394,
      "pose_mae_dx": 0.025256965309381485,
      "pose_mae_dy": 0.016936402767896652,
      "pose_rmse_dtheta": 0.13772135972976685,
      "pose_rmse_dx": 0.08389423042535782,
      "pose_rmse_dy": 0.054132021963596344,
      "pose_rmse_mean": 0.09191586822271347,
      "rmse_dtheta": 0.019844526425004005,
      "rmse_dx": 0.009135639294981956,
      "rmse_dy": 0.0035139957908540964,
      "rmse_mean": 0.010831387713551521,
      "rotation_flip": 0.0005202913889661431,
      "sparse_tokens": 32169.0,
      "step": 2818,
      "turn_loss": 0.08222194015979767,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24912.0,
      "epoch": 0.13097007991079726,
      "grad_norm": 0.7326560616493225,
      "learning_rate": 8.78047908197104e-06,
      "loss": 0.1569,
      "mae_dtheta": 0.03792992979288101,
      "mae_dx": 0.01153158862143755,
      "mae_dy": 0.006627188064157963,
      "pose_mae_dtheta": 0.3096991777420044,
      "pose_mae_dx": 0.1030416414141655,
      "pose_mae_dy": 0.07362084835767746,
      "pose_rmse_dtheta": 0.553328812122345,
      "pose_rmse_dx": 0.20995166897773743,
      "pose_rmse_dy": 0.17516164481639862,
      "pose_rmse_mean": 0.31281405687332153,
      "rmse_dtheta": 0.057562313973903656,
      "rmse_dx": 0.02234281226992607,
      "rmse_dy": 0.014173625037074089,
      "rmse_mean": 0.031359583139419556,
      "rotation_flip": 0.013876843266189098,
      "sparse_tokens": 19899.0,
      "step": 2819,
      "turn_loss": 0.28322991728782654,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.13101653967664004,
      "grad_norm": 0.5211463570594788,
      "learning_rate": 8.779613609026371e-06,
      "loss": 0.1387,
      "mae_dtheta": 0.013044845312833786,
      "mae_dx": 0.002772583393380046,
      "mae_dy": 0.003332054242491722,
      "pose_mae_dtheta": 0.09050404280424118,
      "pose_mae_dx": 0.02982967719435692,
      "pose_mae_dy": 0.0375710092484951,
      "pose_rmse_dtheta": 0.20500056445598602,
      "pose_rmse_dx": 0.0666145607829094,
      "pose_rmse_dy": 0.08473276346921921,
      "pose_rmse_mean": 0.11878263205289841,
      "rmse_dtheta": 0.025792622938752174,
      "rmse_dx": 0.008031449280679226,
      "rmse_dy": 0.008157557807862759,
      "rmse_mean": 0.013993876986205578,
      "rotation_flip": 0.008362369611859322,
      "sparse_tokens": 32121.0,
      "step": 2820,
      "turn_loss": 0.1170155480504036,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.1310629994424828,
      "grad_norm": 0.5705044865608215,
      "learning_rate": 8.778747871771293e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.03587337210774422,
      "mae_dx": 0.008990529924631119,
      "mae_dy": 0.0034620529040694237,
      "pose_mae_dtheta": 0.28173473477363586,
      "pose_mae_dx": 0.07586889714002609,
      "pose_mae_dy": 0.036385197192430496,
      "pose_rmse_dtheta": 0.49740564823150635,
      "pose_rmse_dx": 0.14832116663455963,
      "pose_rmse_dy": 0.09663837403059006,
      "pose_rmse_mean": 0.24745506048202515,
      "rmse_dtheta": 0.05614195019006729,
      "rmse_dx": 0.0187712199985981,
      "rmse_dy": 0.007061885204166174,
      "rmse_mean": 0.027325019240379333,
      "rotation_flip": 0.01005025114864111,
      "sparse_tokens": 9832.0,
      "step": 2821,
      "turn_loss": 0.2509676218032837,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1311094592083256,
      "grad_norm": 1.260820746421814,
      "learning_rate": 8.777881870266347e-06,
      "loss": 0.1393,
      "mae_dtheta": 0.011072210036218166,
      "mae_dx": 0.0013710205676034093,
      "mae_dy": 0.001027690595947206,
      "pose_mae_dtheta": 0.07582826912403107,
      "pose_mae_dx": 0.013659016229212284,
      "pose_mae_dy": 0.014713438227772713,
      "pose_rmse_dtheta": 0.2547523081302643,
      "pose_rmse_dx": 0.031334489583969116,
      "pose_rmse_dy": 0.040599629282951355,
      "pose_rmse_mean": 0.10889548063278198,
      "rmse_dtheta": 0.031425587832927704,
      "rmse_dx": 0.004141844809055328,
      "rmse_dy": 0.0024900948628783226,
      "rmse_mean": 0.01268584281206131,
      "rotation_flip": 0.0010498687624931335,
      "sparse_tokens": 32153.0,
      "step": 2822,
      "turn_loss": 0.06383815407752991,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.13115591897416837,
      "grad_norm": 0.5194339156150818,
      "learning_rate": 8.777015604572094e-06,
      "loss": 0.075,
      "mae_dtheta": 0.025930095463991165,
      "mae_dx": 0.004357759840786457,
      "mae_dy": 0.0034760523121804,
      "pose_mae_dtheta": 0.23471106588840485,
      "pose_mae_dx": 0.0391390323638916,
      "pose_mae_dy": 0.06321584433317184,
      "pose_rmse_dtheta": 0.37841087579727173,
      "pose_rmse_dx": 0.08162213116884232,
      "pose_rmse_dy": 0.1308141052722931,
      "pose_rmse_mean": 0.1969490498304367,
      "rmse_dtheta": 0.04040776193141937,
      "rmse_dx": 0.010864617303013802,
      "rmse_dy": 0.006760746706277132,
      "rmse_mean": 0.019344374537467957,
      "rotation_flip": 0.003610108280554414,
      "sparse_tokens": 5610.0,
      "step": 2823,
      "turn_loss": 0.15673066675662994,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.13120237874001114,
      "grad_norm": 1.5095081329345703,
      "learning_rate": 8.776149074749114e-06,
      "loss": 0.2793,
      "mae_dtheta": 0.03325842320919037,
      "mae_dx": 0.009065482765436172,
      "mae_dy": 0.007966595701873302,
      "pose_mae_dtheta": 0.2574968934059143,
      "pose_mae_dx": 0.07002090662717819,
      "pose_mae_dy": 0.06798651814460754,
      "pose_rmse_dtheta": 0.44734424352645874,
      "pose_rmse_dx": 0.13051430881023407,
      "pose_rmse_dy": 0.14292185008525848,
      "pose_rmse_mean": 0.24026015400886536,
      "rmse_dtheta": 0.0480211116373539,
      "rmse_dx": 0.018169214949011803,
      "rmse_dy": 0.015510238707065582,
      "rmse_mean": 0.02723352238535881,
      "rotation_flip": 0.018518518656492233,
      "sparse_tokens": 10381.0,
      "step": 2824,
      "turn_loss": 0.2924264371395111,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.13124883850585392,
      "grad_norm": 1.019993782043457,
      "learning_rate": 8.775282280858e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.02509857714176178,
      "mae_dx": 0.008147277869284153,
      "mae_dy": 0.0026045190170407295,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999990463256836,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 135.24188232421875,
      "model/head/act_norm_mean": 110.92369887408088,
      "model/head/act_norm_min": 76.44694519042969,
      "model/head/act_over_embed": 76.22780435029883,
      "model/head/grad_frac": 0.08118007332086563,
      "model/head/grad_norm": 0.08117999881505966,
      "model/head/grad_zero_frac": 0.00012341872206889093,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6768727022058824,
      "model/head/update_ratio": 0.0014021951938048005,
      "model/head/weight_delta": 6.203454971313477,
      "model/head/weight_delta_rel": 0.10882697254419327,
      "model/head/weight_norm": 57.894935607910156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4156802296638489,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4156249894036187,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4155672490596771,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2856213838606235,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07281088083982468,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0728108137845993,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5451388888888888,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002363214734941721,
      "model/modality_embedder.encoders.pose/weight_delta": 2.0309042930603027,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06635597348213196,
      "model/modality_embedder.encoders.pose/weight_norm": 30.810070037841797,
      "model/modality_embedder/grad_frac": 0.07281088083982468,
      "model/modality_embedder/grad_norm": 0.0728108137845993,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5451388888888888,
      "model/modality_embedder/update_ratio": 0.002363214734941721,
      "model/modality_embedder/weight_delta": 2.0309042930603027,
      "model/modality_embedder/weight_delta_rel": 0.06635597348213196,
      "model/modality_embedder/weight_norm": 30.810070037841797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 76.8194580078125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.534937412464988,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.303818702697754,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.173429327401468,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06311485171318054,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06311479210853577,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0022811442613601685,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.3390551805496216,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04879597947001457,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.668039321899414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.27153778076172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.45953329248366,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.818076133728027,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.80882027235331,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06871283054351807,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0687127634882927,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002347150119021535,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.6788697242736816,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.058157358318567276,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.274974822998047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.77291107177734,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.165182218720823,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.601130485534668,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.980958183000325,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08749422430992126,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0874941423535347,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 7.565364649053663e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002895524725317955,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.799986481666565,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.060440175235271454,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.217023849487305,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 80.47362518310547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.044834339985993,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.702598571777344,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.272672718314162,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1220792606472969,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.12207914143800735,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 6.556649168487638e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.004128011874854565,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.5352838039398193,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.052468713372945786,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.57335090637207,
      "model/normalizer/grad_frac": 0.4422975182533264,
      "model/normalizer/grad_norm": 0.442297101020813,
      "model/normalizer/grad_zero_frac": 0.00010281123832101002,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.005663106683641672,
      "model/normalizer/weight_delta": 3.2709457874298096,
      "model/normalizer/weight_delta_rel": 0.04212788864970207,
      "model/normalizer/weight_norm": 78.10149383544922,
      "pose_mae_dtheta": 0.1776994913816452,
      "pose_mae_dx": 0.057042594999074936,
      "pose_mae_dy": 0.03121427446603775,
      "pose_rmse_dtheta": 0.3885148763656616,
      "pose_rmse_dx": 0.13703787326812744,
      "pose_rmse_dy": 0.09990470856428146,
      "pose_rmse_mean": 0.20848582684993744,
      "rmse_dtheta": 0.046106304973363876,
      "rmse_dx": 0.018040988594293594,
      "rmse_dy": 0.006488377694040537,
      "rmse_mean": 0.023545224219560623,
      "rotation_flip": 0.005025125574320555,
      "sparse_tokens": 4310.0,
      "step": 2825,
      "turn_loss": 0.17527328431606293,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.1312952982716967,
      "grad_norm": 1.163772702217102,
      "learning_rate": 8.774415222959371e-06,
      "loss": 0.3102,
      "mae_dtheta": 0.033158570528030396,
      "mae_dx": 0.014645145274698734,
      "mae_dy": 0.0049667502753436565,
      "pose_mae_dtheta": 0.2648145854473114,
      "pose_mae_dx": 0.10926742106676102,
      "pose_mae_dy": 0.06562085449695587,
      "pose_rmse_dtheta": 0.46814703941345215,
      "pose_rmse_dx": 0.24630197882652283,
      "pose_rmse_dy": 0.15832531452178955,
      "pose_rmse_mean": 0.2909247875213623,
      "rmse_dtheta": 0.049748197197914124,
      "rmse_dx": 0.02890603430569172,
      "rmse_dy": 0.008949214592576027,
      "rmse_mean": 0.029201148077845573,
      "rotation_flip": 0.011419249698519707,
      "sparse_tokens": 21834.0,
      "step": 2826,
      "turn_loss": 0.2854696214199066,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 14295.0,
      "epoch": 0.1313417580375395,
      "grad_norm": 0.5891405344009399,
      "learning_rate": 8.773547901113862e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.031242379918694496,
      "mae_dx": 0.010846978053450584,
      "mae_dy": 0.0037028046790510416,
      "pose_mae_dtheta": 0.23821614682674408,
      "pose_mae_dx": 0.08314026147127151,
      "pose_mae_dy": 0.06633605062961578,
      "pose_rmse_dtheta": 0.49897366762161255,
      "pose_rmse_dx": 0.21691599488258362,
      "pose_rmse_dy": 0.17359812557697296,
      "pose_rmse_mean": 0.2964959442615509,
      "rmse_dtheta": 0.05328971520066261,
      "rmse_dx": 0.024129124358296394,
      "rmse_dy": 0.00770794041454792,
      "rmse_mean": 0.028375593945384026,
      "rotation_flip": 0.003683241317048669,
      "sparse_tokens": 11678.0,
      "step": 2827,
      "turn_loss": 0.22120514512062073,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.13138821780338228,
      "grad_norm": 0.7808139324188232,
      "learning_rate": 8.77268031538212e-06,
      "loss": 0.1917,
      "mae_dtheta": 0.013679463416337967,
      "mae_dx": 0.0021926886402070522,
      "mae_dy": 0.0031716604717075825,
      "pose_mae_dtheta": 0.09913840889930725,
      "pose_mae_dx": 0.025906680151820183,
      "pose_mae_dy": 0.03267274051904678,
      "pose_rmse_dtheta": 0.2019360363483429,
      "pose_rmse_dx": 0.06394904851913452,
      "pose_rmse_dy": 0.07779856026172638,
      "pose_rmse_mean": 0.11456122249364853,
      "rmse_dtheta": 0.02464108355343342,
      "rmse_dx": 0.005766953341662884,
      "rmse_dy": 0.006691777613013983,
      "rmse_mean": 0.012366604059934616,
      "rotation_flip": 0.006491027306765318,
      "sparse_tokens": 32073.0,
      "step": 2828,
      "turn_loss": 0.12613920867443085,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.13143467756922506,
      "grad_norm": 0.40827542543411255,
      "learning_rate": 8.771812465824818e-06,
      "loss": 0.0804,
      "mae_dtheta": 0.008109243586659431,
      "mae_dx": 0.001222998951561749,
      "mae_dy": 0.001593880821019411,
      "pose_mae_dtheta": 0.0519552119076252,
      "pose_mae_dx": 0.0158198531717062,
      "pose_mae_dy": 0.023743845522403717,
      "pose_rmse_dtheta": 0.14475829899311066,
      "pose_rmse_dx": 0.04191572591662407,
      "pose_rmse_dy": 0.07559946179389954,
      "pose_rmse_mean": 0.08742450177669525,
      "rmse_dtheta": 0.019930746406316757,
      "rmse_dx": 0.0033540241420269012,
      "rmse_dy": 0.0039051114581525326,
      "rmse_mean": 0.009063294157385826,
      "rotation_flip": 0.0015329585876315832,
      "sparse_tokens": 32073.0,
      "step": 2829,
      "turn_loss": 0.06349077820777893,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.13148113733506783,
      "grad_norm": 0.9382601380348206,
      "learning_rate": 8.770944352502649e-06,
      "loss": 0.2937,
      "mae_dtheta": 0.02997373789548874,
      "mae_dx": 0.010515891946852207,
      "mae_dy": 0.007295639719814062,
      "pose_mae_dtheta": 0.21896937489509583,
      "pose_mae_dx": 0.0866754800081253,
      "pose_mae_dy": 0.09568023681640625,
      "pose_rmse_dtheta": 0.37398797273635864,
      "pose_rmse_dx": 0.1820126622915268,
      "pose_rmse_dy": 0.1998426914215088,
      "pose_rmse_mean": 0.2519477903842926,
      "rmse_dtheta": 0.045175209641456604,
      "rmse_dx": 0.022570688277482986,
      "rmse_dy": 0.014191964641213417,
      "rmse_mean": 0.027312619611620903,
      "rotation_flip": 0.01370906364172697,
      "sparse_tokens": 18897.0,
      "step": 2830,
      "turn_loss": 0.29904699325561523,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1315275971009106,
      "grad_norm": 0.7721875309944153,
      "learning_rate": 8.770075975476316e-06,
      "loss": 0.1612,
      "mae_dtheta": 0.010163367725908756,
      "mae_dx": 0.001991807948797941,
      "mae_dy": 0.0024838957469910383,
      "pose_mae_dtheta": 0.06714758276939392,
      "pose_mae_dx": 0.025831131264567375,
      "pose_mae_dy": 0.027858147397637367,
      "pose_rmse_dtheta": 0.17644676566123962,
      "pose_rmse_dx": 0.0588807538151741,
      "pose_rmse_dy": 0.055858347564935684,
      "pose_rmse_mean": 0.09706195443868637,
      "rmse_dtheta": 0.022601578384637833,
      "rmse_dx": 0.00538784172385931,
      "rmse_dy": 0.004878763109445572,
      "rmse_mean": 0.010956062003970146,
      "rotation_flip": 0.0052750566974282265,
      "sparse_tokens": 32105.0,
      "step": 2831,
      "turn_loss": 0.09104501456022263,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.13157405686675339,
      "grad_norm": 1.0093181133270264,
      "learning_rate": 8.769207334806543e-06,
      "loss": 0.3186,
      "mae_dtheta": 0.03625321388244629,
      "mae_dx": 0.014281709678471088,
      "mae_dy": 0.007723418530076742,
      "pose_mae_dtheta": 0.252699613571167,
      "pose_mae_dx": 0.11752990633249283,
      "pose_mae_dy": 0.0830756202340126,
      "pose_rmse_dtheta": 0.4601390063762665,
      "pose_rmse_dx": 0.24114803969860077,
      "pose_rmse_dy": 0.18234476447105408,
      "pose_rmse_mean": 0.29454395174980164,
      "rmse_dtheta": 0.054672349244356155,
      "rmse_dx": 0.027179289609193802,
      "rmse_dy": 0.015400009229779243,
      "rmse_mean": 0.032417215406894684,
      "rotation_flip": 0.02654867246747017,
      "sparse_tokens": 21257.0,
      "step": 2832,
      "turn_loss": 0.3492378890514374,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.13162051663259616,
      "grad_norm": 0.9922181367874146,
      "learning_rate": 8.768338430554083e-06,
      "loss": 0.1427,
      "mae_dtheta": 0.04171226546168327,
      "mae_dx": 0.012268411926925182,
      "mae_dy": 0.005821326747536659,
      "pose_mae_dtheta": 0.3443577289581299,
      "pose_mae_dx": 0.09768594801425934,
      "pose_mae_dy": 0.07696813344955444,
      "pose_rmse_dtheta": 0.5943648219108582,
      "pose_rmse_dx": 0.20158660411834717,
      "pose_rmse_dy": 0.16949310898780823,
      "pose_rmse_mean": 0.3218148648738861,
      "rmse_dtheta": 0.0629877820611,
      "rmse_dx": 0.02459295094013214,
      "rmse_dy": 0.010818487033247948,
      "rmse_mean": 0.03279974311590195,
      "rotation_flip": 0.01591895893216133,
      "sparse_tokens": 12276.0,
      "step": 2833,
      "turn_loss": 0.29569005966186523,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.13166697639843894,
      "grad_norm": 0.6522924304008484,
      "learning_rate": 8.767469262779692e-06,
      "loss": 0.1761,
      "mae_dtheta": 0.01634715124964714,
      "mae_dx": 0.004342491272836924,
      "mae_dy": 0.004926601424813271,
      "pose_mae_dtheta": 0.11785287410020828,
      "pose_mae_dx": 0.05494247376918793,
      "pose_mae_dy": 0.0554763488471508,
      "pose_rmse_dtheta": 0.25681188702583313,
      "pose_rmse_dx": 0.1385190635919571,
      "pose_rmse_dy": 0.13202227652072906,
      "pose_rmse_mean": 0.1757844090461731,
      "rmse_dtheta": 0.031452570110559464,
      "rmse_dx": 0.011347556486725807,
      "rmse_dy": 0.01108646485954523,
      "rmse_mean": 0.017962198704481125,
      "rotation_flip": 0.0035688793286681175,
      "sparse_tokens": 32105.0,
      "step": 2834,
      "turn_loss": 0.16188596189022064,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.13171343616428174,
      "grad_norm": 0.5142768621444702,
      "learning_rate": 8.766599831544154e-06,
      "loss": 0.1237,
      "mae_dtheta": 0.042929161339998245,
      "mae_dx": 0.011326068080961704,
      "mae_dy": 0.0021818748209625483,
      "pose_mae_dtheta": 0.335405170917511,
      "pose_mae_dx": 0.08107046782970428,
      "pose_mae_dy": 0.02060636691749096,
      "pose_rmse_dtheta": 0.6159763336181641,
      "pose_rmse_dx": 0.2133169174194336,
      "pose_rmse_dy": 0.050014812499284744,
      "pose_rmse_mean": 0.2931026816368103,
      "rmse_dtheta": 0.06667619198560715,
      "rmse_dx": 0.02413504756987095,
      "rmse_dy": 0.0043756961822509766,
      "rmse_mean": 0.03172897920012474,
      "rotation_flip": 0.012755102477967739,
      "sparse_tokens": 5709.0,
      "step": 2835,
      "turn_loss": 0.27623364329338074,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.13175989593012452,
      "grad_norm": 0.7482458353042603,
      "learning_rate": 8.765730136908266e-06,
      "loss": 0.1665,
      "mae_dtheta": 0.04002225399017334,
      "mae_dx": 0.018333617597818375,
      "mae_dy": 0.0026888151187449694,
      "pose_mae_dtheta": 0.3380907475948334,
      "pose_mae_dx": 0.14610835909843445,
      "pose_mae_dy": 0.02648833394050598,
      "pose_rmse_dtheta": 0.5859237909317017,
      "pose_rmse_dx": 0.31434500217437744,
      "pose_rmse_dy": 0.060574766248464584,
      "pose_rmse_mean": 0.3202812075614929,
      "rmse_dtheta": 0.05906431004405022,
      "rmse_dx": 0.032333388924598694,
      "rmse_dy": 0.004897708538919687,
      "rmse_mean": 0.032098472118377686,
      "rotation_flip": 0.011128775775432587,
      "sparse_tokens": 11364.0,
      "step": 2836,
      "turn_loss": 0.319820761680603,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.1318063556959673,
      "grad_norm": 0.5819749236106873,
      "learning_rate": 8.76486017893285e-06,
      "loss": 0.0994,
      "mae_dtheta": 0.03060894086956978,
      "mae_dx": 0.010372055694460869,
      "mae_dy": 0.005282995291054249,
      "pose_mae_dtheta": 0.25534653663635254,
      "pose_mae_dx": 0.09211303293704987,
      "pose_mae_dy": 0.05762016400694847,
      "pose_rmse_dtheta": 0.45958632230758667,
      "pose_rmse_dx": 0.18395555019378662,
      "pose_rmse_dy": 0.15565770864486694,
      "pose_rmse_mean": 0.2663998603820801,
      "rmse_dtheta": 0.047148197889328,
      "rmse_dx": 0.020119858905673027,
      "rmse_dy": 0.011086991988122463,
      "rmse_mean": 0.02611835114657879,
      "rotation_flip": 0.008130080997943878,
      "sparse_tokens": 11511.0,
      "step": 2837,
      "turn_loss": 0.27546635270118713,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13185281546181007,
      "grad_norm": 0.6553857922554016,
      "learning_rate": 8.763989957678743e-06,
      "loss": 0.0945,
      "mae_dtheta": 0.010344328358769417,
      "mae_dx": 0.0030154241248965263,
      "mae_dy": 0.0020627344492822886,
      "pose_mae_dtheta": 0.08014930039644241,
      "pose_mae_dx": 0.029053278267383575,
      "pose_mae_dy": 0.029751744121313095,
      "pose_rmse_dtheta": 0.20426766574382782,
      "pose_rmse_dx": 0.08443678170442581,
      "pose_rmse_dy": 0.08342885971069336,
      "pose_rmse_mean": 0.12404444068670273,
      "rmse_dtheta": 0.024559399113059044,
      "rmse_dx": 0.009722907096147537,
      "rmse_dy": 0.005597889423370361,
      "rmse_mean": 0.013293398544192314,
      "rotation_flip": 0.005690636113286018,
      "sparse_tokens": 32089.0,
      "step": 2838,
      "turn_loss": 0.08468581736087799,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.13189927522765285,
      "grad_norm": 0.47919172048568726,
      "learning_rate": 8.763119473206795e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.028280245140194893,
      "mae_dx": 0.012622366659343243,
      "mae_dy": 0.004467859864234924,
      "pose_mae_dtheta": 0.22886209189891815,
      "pose_mae_dx": 0.11530879884958267,
      "pose_mae_dy": 0.06948716193437576,
      "pose_rmse_dtheta": 0.42669999599456787,
      "pose_rmse_dx": 0.2509278357028961,
      "pose_rmse_dy": 0.15283991396427155,
      "pose_rmse_mean": 0.276822566986084,
      "rmse_dtheta": 0.0464584082365036,
      "rmse_dx": 0.025865592062473297,
      "rmse_dy": 0.009270003996789455,
      "rmse_mean": 0.027198001742362976,
      "rotation_flip": 0.014836795628070831,
      "sparse_tokens": 6768.0,
      "step": 2839,
      "turn_loss": 0.1676420420408249,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.13194573499349563,
      "grad_norm": 0.8854079246520996,
      "learning_rate": 8.762248725577882e-06,
      "loss": 0.2825,
      "mae_dtheta": 0.03032018058001995,
      "mae_dx": 0.020201977342367172,
      "mae_dy": 0.006927912589162588,
      "pose_mae_dtheta": 0.17727521061897278,
      "pose_mae_dx": 0.1553274244070053,
      "pose_mae_dy": 0.10178233683109283,
      "pose_rmse_dtheta": 0.2824420630931854,
      "pose_rmse_dx": 0.30305373668670654,
      "pose_rmse_dy": 0.19536922872066498,
      "pose_rmse_mean": 0.2602883577346802,
      "rmse_dtheta": 0.04440759867429733,
      "rmse_dx": 0.03466477617621422,
      "rmse_dy": 0.012931691482663155,
      "rmse_mean": 0.030668020248413086,
      "rotation_flip": 0.024000000208616257,
      "sparse_tokens": 5033.0,
      "step": 2840,
      "turn_loss": 0.25282931327819824,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.1319921947593384,
      "grad_norm": 0.5081161260604858,
      "learning_rate": 8.7613777148529e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.045922789722681046,
      "mae_dx": 0.019061606377363205,
      "mae_dy": 0.004869989585131407,
      "pose_mae_dtheta": 0.40440109372138977,
      "pose_mae_dx": 0.1683957725763321,
      "pose_mae_dy": 0.06994862109422684,
      "pose_rmse_dtheta": 0.6440948843955994,
      "pose_rmse_dx": 0.31546851992607117,
      "pose_rmse_dy": 0.16051119565963745,
      "pose_rmse_mean": 0.37335819005966187,
      "rmse_dtheta": 0.0641547292470932,
      "rmse_dx": 0.031949833035469055,
      "rmse_dy": 0.008956938982009888,
      "rmse_mean": 0.03502050042152405,
      "rotation_flip": 0.014516129158437252,
      "sparse_tokens": 9568.0,
      "step": 2841,
      "turn_loss": 0.3920343816280365,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.13203865452518118,
      "grad_norm": 0.7779454588890076,
      "learning_rate": 8.760506441092751e-06,
      "loss": 0.232,
      "mae_dtheta": 0.030383631587028503,
      "mae_dx": 0.011552887968719006,
      "mae_dy": 0.005914710462093353,
      "pose_mae_dtheta": 0.21789555251598358,
      "pose_mae_dx": 0.09539321064949036,
      "pose_mae_dy": 0.05680714175105095,
      "pose_rmse_dtheta": 0.39654216170310974,
      "pose_rmse_dx": 0.20792527496814728,
      "pose_rmse_dy": 0.11643029749393463,
      "pose_rmse_mean": 0.240299254655838,
      "rmse_dtheta": 0.047288913279771805,
      "rmse_dx": 0.022685257717967033,
      "rmse_dy": 0.011837915517389774,
      "rmse_mean": 0.027270695194602013,
      "rotation_flip": 0.019801979884505272,
      "sparse_tokens": 12098.0,
      "step": 2842,
      "turn_loss": 0.30981695652008057,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.132085114291024,
      "grad_norm": 0.49582499265670776,
      "learning_rate": 8.75963490435837e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.00898668821901083,
      "mae_dx": 0.001972452737390995,
      "mae_dy": 0.0016547261038795114,
      "pose_mae_dtheta": 0.06599286943674088,
      "pose_mae_dx": 0.020738834515213966,
      "pose_mae_dy": 0.02461910806596279,
      "pose_rmse_dtheta": 0.1776699274778366,
      "pose_rmse_dx": 0.058042388409376144,
      "pose_rmse_dy": 0.05921168625354767,
      "pose_rmse_mean": 0.0983080118894577,
      "rmse_dtheta": 0.02149302326142788,
      "rmse_dx": 0.005665927659720182,
      "rmse_dy": 0.004690021742135286,
      "rmse_mean": 0.010616324841976166,
      "rotation_flip": 0.004273504484444857,
      "sparse_tokens": 32137.0,
      "step": 2843,
      "turn_loss": 0.06876122951507568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.13213157405686676,
      "grad_norm": 0.809345006942749,
      "learning_rate": 8.758763104710703e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.027921268716454506,
      "mae_dx": 0.006782223004847765,
      "mae_dy": 0.005185471847653389,
      "pose_mae_dtheta": 0.22012123465538025,
      "pose_mae_dx": 0.06971392780542374,
      "pose_mae_dy": 0.07515188306570053,
      "pose_rmse_dtheta": 0.4037805199623108,
      "pose_rmse_dx": 0.14679084718227386,
      "pose_rmse_dy": 0.141113743185997,
      "pose_rmse_mean": 0.23056171834468842,
      "rmse_dtheta": 0.04511668533086777,
      "rmse_dx": 0.015332617796957493,
      "rmse_dy": 0.008851735852658749,
      "rmse_mean": 0.023100346326828003,
      "rotation_flip": 0.012345679104328156,
      "sparse_tokens": 6099.0,
      "step": 2844,
      "turn_loss": 0.24129705131053925,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.13217803382270954,
      "grad_norm": 0.738298773765564,
      "learning_rate": 8.757891042210713e-06,
      "loss": 0.1552,
      "mae_dtheta": 0.03588443621993065,
      "mae_dx": 0.007687657605856657,
      "mae_dy": 0.0029002674855291843,
      "pose_mae_dtheta": 0.29097411036491394,
      "pose_mae_dx": 0.05881420522928238,
      "pose_mae_dy": 0.02476602979004383,
      "pose_rmse_dtheta": 0.49274972081184387,
      "pose_rmse_dx": 0.12326720356941223,
      "pose_rmse_dy": 0.05642666295170784,
      "pose_rmse_mean": 0.22414785623550415,
      "rmse_dtheta": 0.055194925516843796,
      "rmse_dx": 0.014657124876976013,
      "rmse_dy": 0.006136377342045307,
      "rmse_mean": 0.025329478085041046,
      "rotation_flip": 0.008498583920300007,
      "sparse_tokens": 6422.0,
      "step": 2845,
      "turn_loss": 0.2452588528394699,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13222449358855232,
      "grad_norm": 0.5453498959541321,
      "learning_rate": 8.757018716919388e-06,
      "loss": 0.0857,
      "mae_dtheta": 0.012114400044083595,
      "mae_dx": 0.0012860732385888696,
      "mae_dy": 0.002426719292998314,
      "pose_mae_dtheta": 0.06741981208324432,
      "pose_mae_dx": 0.02165479026734829,
      "pose_mae_dy": 0.030292075127363205,
      "pose_rmse_dtheta": 0.1293528974056244,
      "pose_rmse_dx": 0.04820237681269646,
      "pose_rmse_dy": 0.061548374593257904,
      "pose_rmse_mean": 0.07970121502876282,
      "rmse_dtheta": 0.021733712404966354,
      "rmse_dx": 0.003733008401468396,
      "rmse_dy": 0.00454838527366519,
      "rmse_mean": 0.010005036368966103,
      "rotation_flip": 0.0029479200020432472,
      "sparse_tokens": 32089.0,
      "step": 2846,
      "turn_loss": 0.09664921462535858,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15267.0,
      "epoch": 0.1322709533543951,
      "grad_norm": 0.5098910331726074,
      "learning_rate": 8.756146128897727e-06,
      "loss": 0.1086,
      "mae_dtheta": 0.0306697990745306,
      "mae_dx": 0.00665093632414937,
      "mae_dy": 0.006257920991629362,
      "pose_mae_dtheta": 0.23440702259540558,
      "pose_mae_dx": 0.06373104453086853,
      "pose_mae_dy": 0.06999137997627258,
      "pose_rmse_dtheta": 0.4159471392631531,
      "pose_rmse_dx": 0.14442986249923706,
      "pose_rmse_dy": 0.14860929548740387,
      "pose_rmse_mean": 0.23632876574993134,
      "rmse_dtheta": 0.04790904372930527,
      "rmse_dx": 0.015645328909158707,
      "rmse_dy": 0.01119091548025608,
      "rmse_mean": 0.024915097281336784,
      "rotation_flip": 0.010370370000600815,
      "sparse_tokens": 12752.0,
      "step": 2847,
      "turn_loss": 0.29254403710365295,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.13231741312023787,
      "grad_norm": 0.7912207245826721,
      "learning_rate": 8.75527327820675e-06,
      "loss": 0.1828,
      "mae_dtheta": 0.042610131204128265,
      "mae_dx": 0.018971871584653854,
      "mae_dy": 0.009725019335746765,
      "pose_mae_dtheta": 0.3360886871814728,
      "pose_mae_dx": 0.17937858402729034,
      "pose_mae_dy": 0.12348584830760956,
      "pose_rmse_dtheta": 0.5655397772789001,
      "pose_rmse_dx": 0.34708860516548157,
      "pose_rmse_dy": 0.290640264749527,
      "pose_rmse_mean": 0.40108954906463623,
      "rmse_dtheta": 0.05955531820654869,
      "rmse_dx": 0.0328032486140728,
      "rmse_dy": 0.019692741334438324,
      "rmse_mean": 0.03735043853521347,
      "rotation_flip": 0.020768431946635246,
      "sparse_tokens": 17180.0,
      "step": 2848,
      "turn_loss": 0.38820329308509827,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.13236387288608065,
      "grad_norm": 0.64088374376297,
      "learning_rate": 8.754400164907496e-06,
      "loss": 0.1303,
      "mae_dtheta": 0.031588077545166016,
      "mae_dx": 0.011115890927612782,
      "mae_dy": 0.0033348507713526487,
      "pose_mae_dtheta": 0.241760715842247,
      "pose_mae_dx": 0.08667595684528351,
      "pose_mae_dy": 0.03566420078277588,
      "pose_rmse_dtheta": 0.4254029095172882,
      "pose_rmse_dx": 0.2113620489835739,
      "pose_rmse_dy": 0.08460620045661926,
      "pose_rmse_mean": 0.24045705795288086,
      "rmse_dtheta": 0.04844057187438011,
      "rmse_dx": 0.0235439445823431,
      "rmse_dy": 0.006673982832580805,
      "rmse_mean": 0.026219500228762627,
      "rotation_flip": 0.011583011597394943,
      "sparse_tokens": 21670.0,
      "step": 2849,
      "turn_loss": 0.27204734086990356,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 30494.0,
      "epoch": 0.13241033265192342,
      "grad_norm": 0.5966703295707703,
      "learning_rate": 8.753526789061026e-06,
      "loss": 0.1625,
      "mae_dtheta": 0.03588348254561424,
      "mae_dx": 0.01277695782482624,
      "mae_dy": 0.00585275748744607,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5966703295707703,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.5772705078125,
      "model/head/act_norm_mean": 102.68919340093085,
      "model/head/act_norm_min": 57.699195861816406,
      "model/head/act_over_embed": 70.56897509649527,
      "model/head/grad_frac": 0.09452320635318756,
      "model/head/grad_norm": 0.05639919266104698,
      "model/head/grad_zero_frac": 0.00019829485972877592,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6792823304521277,
      "model/head/update_ratio": 0.0009740469977259636,
      "model/head/weight_delta": 6.230870246887207,
      "model/head/weight_delta_rel": 0.1093079224228859,
      "model/head/weight_norm": 57.901920318603516,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4157508611679077,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41569611398797285,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41563257575035095,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28567026134087053,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09342209994792938,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05574219301342964,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5248149671052632,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0018091597594320774,
      "model/modality_embedder.encoders.pose/weight_delta": 2.0430586338043213,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0667530968785286,
      "model/modality_embedder.encoders.pose/weight_norm": 30.811094284057617,
      "model/modality_embedder/grad_frac": 0.09342209994792938,
      "model/modality_embedder/grad_norm": 0.05574219301342964,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5248149671052632,
      "model/modality_embedder/update_ratio": 0.0018091597594320774,
      "model/modality_embedder/weight_delta": 2.0430586338043213,
      "model/modality_embedder/weight_delta_rel": 0.0667530968785286,
      "model/modality_embedder/weight_norm": 30.811094284057617,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.88153076171875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.82309872087133,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.184467315673828,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.68424711419948,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10002296417951584,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05968073382973671,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002156936563551426,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.3483655452728271,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.049135252833366394,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.669212341308594,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 82.35780334472656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.742366915737925,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.5985746383667,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.315976824036238,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09523478895425797,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05682377144694328,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019408132648095489,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.6919217109680176,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.058609489351511,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.278329849243164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.77982330322266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.507635722728807,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.025115966796875,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.529086074907326,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09286177903413773,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05540786683559418,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018334303749725223,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.8134925365447998,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06089368462562561,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.22087287902832,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.11869812011719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.47809808763931,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.529448509216309,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.883206259833134,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09448962658643723,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.056379158049821854,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001906350371427834,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.5461937189102173,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.052841562777757645,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.57439422607422,
      "model/normalizer/grad_frac": 0.3845706582069397,
      "model/normalizer/grad_norm": 0.2294619083404541,
      "model/normalizer/grad_zero_frac": 0.00018198772158939391,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0029378689359873533,
      "model/normalizer/weight_delta": 3.2952349185943604,
      "model/normalizer/weight_delta_rel": 0.04244071617722511,
      "model/normalizer/weight_norm": 78.1048812866211,
      "pose_mae_dtheta": 0.2739347219467163,
      "pose_mae_dx": 0.1097535789012909,
      "pose_mae_dy": 0.0630938932299614,
      "pose_rmse_dtheta": 0.46154817938804626,
      "pose_rmse_dx": 0.2438327819108963,
      "pose_rmse_dy": 0.13274352252483368,
      "pose_rmse_mean": 0.2793748378753662,
      "rmse_dtheta": 0.05229010060429573,
      "rmse_dx": 0.02574552781879902,
      "rmse_dy": 0.01052198838442564,
      "rmse_mean": 0.029519205912947655,
      "rotation_flip": 0.013633265160024166,
      "sparse_tokens": 24430.0,
      "step": 2850,
      "turn_loss": 0.3030390739440918,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.13245679241776623,
      "grad_norm": 0.5043315887451172,
      "learning_rate": 8.752653150728412e-06,
      "loss": 0.135,
      "mae_dtheta": 0.008013554848730564,
      "mae_dx": 0.0014627374475821853,
      "mae_dy": 0.0023182486183941364,
      "pose_mae_dtheta": 0.05404841899871826,
      "pose_mae_dx": 0.020760029554367065,
      "pose_mae_dy": 0.02851957082748413,
      "pose_rmse_dtheta": 0.11040100455284119,
      "pose_rmse_dx": 0.052353620529174805,
      "pose_rmse_dy": 0.07224985957145691,
      "pose_rmse_mean": 0.07833483070135117,
      "rmse_dtheta": 0.016595778986811638,
      "rmse_dx": 0.004507371224462986,
      "rmse_dy": 0.005497954785823822,
      "rmse_mean": 0.008867035619914532,
      "rotation_flip": 0.005893909838050604,
      "sparse_tokens": 32041.0,
      "step": 2851,
      "turn_loss": 0.07961635291576385,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.132503252183609,
      "grad_norm": 0.5224408507347107,
      "learning_rate": 8.751779249970748e-06,
      "loss": 0.163,
      "mae_dtheta": 0.050566043704748154,
      "mae_dx": 0.013330909423530102,
      "mae_dy": 0.006954581011086702,
      "pose_mae_dtheta": 0.4072723984718323,
      "pose_mae_dx": 0.11321764439344406,
      "pose_mae_dy": 0.07924064248800278,
      "pose_rmse_dtheta": 0.6159521341323853,
      "pose_rmse_dx": 0.23478297889232635,
      "pose_rmse_dy": 0.17500312626361847,
      "pose_rmse_mean": 0.34191274642944336,
      "rmse_dtheta": 0.06581911444664001,
      "rmse_dx": 0.025353694334626198,
      "rmse_dy": 0.014444032683968544,
      "rmse_mean": 0.03520561382174492,
      "rotation_flip": 0.020114943385124207,
      "sparse_tokens": 16957.0,
      "step": 2852,
      "turn_loss": 0.38154709339141846,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.13254971194945178,
      "grad_norm": 0.6788566708564758,
      "learning_rate": 8.75090508684915e-06,
      "loss": 0.178,
      "mae_dtheta": 0.010935424827039242,
      "mae_dx": 0.001436310587450862,
      "mae_dy": 0.0019673574715852737,
      "pose_mae_dtheta": 0.0788191631436348,
      "pose_mae_dx": 0.018970198929309845,
      "pose_mae_dy": 0.027467593550682068,
      "pose_rmse_dtheta": 0.21809479594230652,
      "pose_rmse_dx": 0.047437217086553574,
      "pose_rmse_dy": 0.059451717883348465,
      "pose_rmse_mean": 0.10832791775465012,
      "rmse_dtheta": 0.02461371012032032,
      "rmse_dx": 0.004661581479012966,
      "rmse_dy": 0.0040078796446323395,
      "rmse_mean": 0.011094390414655209,
      "rotation_flip": 0.005620232783257961,
      "sparse_tokens": 32073.0,
      "step": 2853,
      "turn_loss": 0.07843150198459625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13259617171529456,
      "grad_norm": 0.5297738909721375,
      "learning_rate": 8.750030661424742e-06,
      "loss": 0.1187,
      "mae_dtheta": 0.015700386837124825,
      "mae_dx": 0.002737194299697876,
      "mae_dy": 0.004582519177347422,
      "pose_mae_dtheta": 0.10741452127695084,
      "pose_mae_dx": 0.03962942212820053,
      "pose_mae_dy": 0.04726937413215637,
      "pose_rmse_dtheta": 0.21445144712924957,
      "pose_rmse_dx": 0.10564935952425003,
      "pose_rmse_dy": 0.09526875615119934,
      "pose_rmse_mean": 0.1384565234184265,
      "rmse_dtheta": 0.028123831376433372,
      "rmse_dx": 0.008433100767433643,
      "rmse_dy": 0.009936345741152763,
      "rmse_mean": 0.015497758984565735,
      "rotation_flip": 0.008922670036554337,
      "sparse_tokens": 32089.0,
      "step": 2854,
      "turn_loss": 0.13791011273860931,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.13264263148113734,
      "grad_norm": 0.7166638970375061,
      "learning_rate": 8.74915597375868e-06,
      "loss": 0.1918,
      "mae_dtheta": 0.028600845485925674,
      "mae_dx": 0.009936569258570671,
      "mae_dy": 0.005685369484126568,
      "pose_mae_dtheta": 0.20466051995754242,
      "pose_mae_dx": 0.0808819904923439,
      "pose_mae_dy": 0.05767231062054634,
      "pose_rmse_dtheta": 0.37348756194114685,
      "pose_rmse_dx": 0.18426167964935303,
      "pose_rmse_dy": 0.12972046434879303,
      "pose_rmse_mean": 0.22915658354759216,
      "rmse_dtheta": 0.045968085527420044,
      "rmse_dx": 0.021602042019367218,
      "rmse_dy": 0.011345439590513706,
      "rmse_mean": 0.026305189356207848,
      "rotation_flip": 0.015224913135170937,
      "sparse_tokens": 22960.0,
      "step": 2855,
      "turn_loss": 0.2772749364376068,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.1326890912469801,
      "grad_norm": 0.624090313911438,
      "learning_rate": 8.748281023912127e-06,
      "loss": 0.1519,
      "mae_dtheta": 0.03783661127090454,
      "mae_dx": 0.010298901237547398,
      "mae_dy": 0.005466194823384285,
      "pose_mae_dtheta": 0.35660555958747864,
      "pose_mae_dx": 0.060026708990335464,
      "pose_mae_dy": 0.07941721379756927,
      "pose_rmse_dtheta": 0.6561781764030457,
      "pose_rmse_dx": 0.10913234204053879,
      "pose_rmse_dy": 0.15817326307296753,
      "pose_rmse_mean": 0.3078279495239258,
      "rmse_dtheta": 0.06264607608318329,
      "rmse_dx": 0.01772434450685978,
      "rmse_dy": 0.011814997531473637,
      "rmse_mean": 0.030728472396731377,
      "rotation_flip": 0.010204081423580647,
      "sparse_tokens": 3444.0,
      "step": 2856,
      "turn_loss": 0.38990893959999084,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.1327355510128229,
      "grad_norm": 0.4849119186401367,
      "learning_rate": 8.747405811946272e-06,
      "loss": 0.1148,
      "mae_dtheta": 0.04442929849028587,
      "mae_dx": 0.011328251101076603,
      "mae_dy": 0.008823833428323269,
      "pose_mae_dtheta": 0.3414919078350067,
      "pose_mae_dx": 0.0857226550579071,
      "pose_mae_dy": 0.07493817806243896,
      "pose_rmse_dtheta": 0.570631206035614,
      "pose_rmse_dx": 0.1771669089794159,
      "pose_rmse_dy": 0.16919302940368652,
      "pose_rmse_mean": 0.30566370487213135,
      "rmse_dtheta": 0.0627095177769661,
      "rmse_dx": 0.021377023309469223,
      "rmse_dy": 0.01656949520111084,
      "rmse_mean": 0.03355201333761215,
      "rotation_flip": 0.014218009077012539,
      "sparse_tokens": 6890.0,
      "step": 2857,
      "turn_loss": 0.37174510955810547,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.13278201077866567,
      "grad_norm": 0.6495921611785889,
      "learning_rate": 8.746530337922314e-06,
      "loss": 0.132,
      "mae_dtheta": 0.006770304404199123,
      "mae_dx": 0.001105927862226963,
      "mae_dy": 0.0007414953433908522,
      "pose_mae_dtheta": 0.05145835131406784,
      "pose_mae_dx": 0.010647358372807503,
      "pose_mae_dy": 0.0125223184004426,
      "pose_rmse_dtheta": 0.20663639903068542,
      "pose_rmse_dx": 0.025743454694747925,
      "pose_rmse_dy": 0.03357697278261185,
      "pose_rmse_mean": 0.08865227550268173,
      "rmse_dtheta": 0.02284351736307144,
      "rmse_dx": 0.0031882883049547672,
      "rmse_dy": 0.001535847899504006,
      "rmse_mean": 0.009189218282699585,
      "rotation_flip": 0.0010712372604757547,
      "sparse_tokens": 32121.0,
      "step": 2858,
      "turn_loss": 0.04640967771410942,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.13282847054450844,
      "grad_norm": 0.6373465657234192,
      "learning_rate": 8.745654601901483e-06,
      "loss": 0.1603,
      "mae_dtheta": 0.031302109360694885,
      "mae_dx": 0.013043762184679508,
      "mae_dy": 0.004414296709001064,
      "pose_mae_dtheta": 0.2520183026790619,
      "pose_mae_dx": 0.10999112576246262,
      "pose_mae_dy": 0.0559651181101799,
      "pose_rmse_dtheta": 0.43243569135665894,
      "pose_rmse_dx": 0.23346562683582306,
      "pose_rmse_dy": 0.12208309024572372,
      "pose_rmse_mean": 0.2626614570617676,
      "rmse_dtheta": 0.04725001007318497,
      "rmse_dx": 0.025316856801509857,
      "rmse_dy": 0.008144278079271317,
      "rmse_mean": 0.02690371498465538,
      "rotation_flip": 0.013605441898107529,
      "sparse_tokens": 10090.0,
      "step": 2859,
      "turn_loss": 0.27136075496673584,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.13287493031035125,
      "grad_norm": 0.760238766670227,
      "learning_rate": 8.744778603945013e-06,
      "loss": 0.1788,
      "mae_dtheta": 0.029963310807943344,
      "mae_dx": 0.007752946577966213,
      "mae_dy": 0.001554068410769105,
      "pose_mae_dtheta": 0.26172804832458496,
      "pose_mae_dx": 0.059760067611932755,
      "pose_mae_dy": 0.020996978506445885,
      "pose_rmse_dtheta": 0.4826117157936096,
      "pose_rmse_dx": 0.14374108612537384,
      "pose_rmse_dy": 0.07343066483736038,
      "pose_rmse_mean": 0.23326115310192108,
      "rmse_dtheta": 0.050760138779878616,
      "rmse_dx": 0.017517033964395523,
      "rmse_dy": 0.0034595474135130644,
      "rmse_mean": 0.02391224168241024,
      "rotation_flip": 0.0038610037881881,
      "sparse_tokens": 4765.0,
      "step": 2860,
      "turn_loss": 0.1547507792711258,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.13292139007619402,
      "grad_norm": 0.4581105411052704,
      "learning_rate": 8.743902344114163e-06,
      "loss": 0.1385,
      "mae_dtheta": 0.033581238240003586,
      "mae_dx": 0.013146691024303436,
      "mae_dy": 0.0036457376554608345,
      "pose_mae_dtheta": 0.26369035243988037,
      "pose_mae_dx": 0.10490895807743073,
      "pose_mae_dy": 0.04191624000668526,
      "pose_rmse_dtheta": 0.47747448086738586,
      "pose_rmse_dx": 0.24499641358852386,
      "pose_rmse_dy": 0.10373275727033615,
      "pose_rmse_mean": 0.27540123462677,
      "rmse_dtheta": 0.05326496437191963,
      "rmse_dx": 0.025944402441382408,
      "rmse_dy": 0.007303478661924601,
      "rmse_mean": 0.02883761376142502,
      "rotation_flip": 0.014672686345875263,
      "sparse_tokens": 16277.0,
      "step": 2861,
      "turn_loss": 0.22604775428771973,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1329678498420368,
      "grad_norm": 0.4173349440097809,
      "learning_rate": 8.743025822470216e-06,
      "loss": 0.1122,
      "mae_dtheta": 0.009968332946300507,
      "mae_dx": 0.002158572431653738,
      "mae_dy": 0.0026993753854185343,
      "pose_mae_dtheta": 0.07247266173362732,
      "pose_mae_dx": 0.02751992456614971,
      "pose_mae_dy": 0.03232339397072792,
      "pose_rmse_dtheta": 0.16296842694282532,
      "pose_rmse_dx": 0.08243384957313538,
      "pose_rmse_dy": 0.08419602364301682,
      "pose_rmse_mean": 0.10986610502004623,
      "rmse_dtheta": 0.021067587658762932,
      "rmse_dx": 0.0073905885219573975,
      "rmse_dy": 0.00652301125228405,
      "rmse_mean": 0.011660396121442318,
      "rotation_flip": 0.006677796132862568,
      "sparse_tokens": 32089.0,
      "step": 2862,
      "turn_loss": 0.08592259138822556,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13301430960787958,
      "grad_norm": 0.5608475804328918,
      "learning_rate": 8.742149039074463e-06,
      "loss": 0.0764,
      "mae_dtheta": 0.010250432416796684,
      "mae_dx": 0.00197211722843349,
      "mae_dy": 0.002261064713820815,
      "pose_mae_dtheta": 0.07286067306995392,
      "pose_mae_dx": 0.024473948404192924,
      "pose_mae_dy": 0.02826489694416523,
      "pose_rmse_dtheta": 0.1735018491744995,
      "pose_rmse_dx": 0.06263647973537445,
      "pose_rmse_dy": 0.06088876724243164,
      "pose_rmse_mean": 0.09900903701782227,
      "rmse_dtheta": 0.021275589242577553,
      "rmse_dx": 0.005869528744369745,
      "rmse_dy": 0.005104660987854004,
      "rmse_mean": 0.010749926790595055,
      "rotation_flip": 0.003561535384505987,
      "sparse_tokens": 32089.0,
      "step": 2863,
      "turn_loss": 0.07526738941669464,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1340.0,
      "epoch": 0.13306076937372235,
      "grad_norm": 0.5278555154800415,
      "learning_rate": 8.741271993988218e-06,
      "loss": 0.0831,
      "mae_dtheta": 0.018832629546523094,
      "mae_dx": 0.008606430143117905,
      "mae_dy": 0.0044237785041332245,
      "pose_mae_dtheta": 0.15889272093772888,
      "pose_mae_dx": 0.0685829445719719,
      "pose_mae_dy": 0.05043105408549309,
      "pose_rmse_dtheta": 0.3003668189048767,
      "pose_rmse_dx": 0.12718568742275238,
      "pose_rmse_dy": 0.07421001046895981,
      "pose_rmse_mean": 0.16725417971611023,
      "rmse_dtheta": 0.028707601130008698,
      "rmse_dx": 0.017567463219165802,
      "rmse_dy": 0.006959900725632906,
      "rmse_mean": 0.017744988203048706,
      "rotation_flip": 0.0,
      "sparse_tokens": 1137.0,
      "step": 2864,
      "turn_loss": 0.17070937156677246,
      "turns": 4.0,
      "turns_per_sample": 4.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.13310722913956513,
      "grad_norm": 0.34549254179000854,
      "learning_rate": 8.740394687272817e-06,
      "loss": 0.0869,
      "mae_dtheta": 0.013750655576586723,
      "mae_dx": 0.003755312878638506,
      "mae_dy": 0.0038531546015292406,
      "pose_mae_dtheta": 0.09624691307544708,
      "pose_mae_dx": 0.031290873885154724,
      "pose_mae_dy": 0.04032973200082779,
      "pose_rmse_dtheta": 0.22445036470890045,
      "pose_rmse_dx": 0.07621356844902039,
      "pose_rmse_dy": 0.08810208737850189,
      "pose_rmse_mean": 0.12958869338035583,
      "rmse_dtheta": 0.028580350801348686,
      "rmse_dx": 0.012720437720417976,
      "rmse_dy": 0.00936188641935587,
      "rmse_mean": 0.01688755862414837,
      "rotation_flip": 0.006213324144482613,
      "sparse_tokens": 32105.0,
      "step": 2865,
      "turn_loss": 0.1445009857416153,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1331536889054079,
      "grad_norm": 0.46370038390159607,
      "learning_rate": 8.739517118989606e-06,
      "loss": 0.123,
      "mae_dtheta": 0.011984328739345074,
      "mae_dx": 0.0027323029935359955,
      "mae_dy": 0.0032737809233367443,
      "pose_mae_dtheta": 0.08800629526376724,
      "pose_mae_dx": 0.03385832905769348,
      "pose_mae_dy": 0.03622099757194519,
      "pose_rmse_dtheta": 0.1821100115776062,
      "pose_rmse_dx": 0.07444038987159729,
      "pose_rmse_dy": 0.08555015921592712,
      "pose_rmse_mean": 0.1140335202217102,
      "rmse_dtheta": 0.023381203413009644,
      "rmse_dx": 0.00688872579485178,
      "rmse_dy": 0.007354526314884424,
      "rmse_mean": 0.012541485950350761,
      "rotation_flip": 0.006217616610229015,
      "sparse_tokens": 32169.0,
      "step": 2866,
      "turn_loss": 0.11085610091686249,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15267.0,
      "epoch": 0.13320014867125068,
      "grad_norm": 0.6417328119277954,
      "learning_rate": 8.738639289199957e-06,
      "loss": 0.1925,
      "mae_dtheta": 0.028262125328183174,
      "mae_dx": 0.008446446619927883,
      "mae_dy": 0.006883971858769655,
      "pose_mae_dtheta": 0.21464534103870392,
      "pose_mae_dx": 0.07451043277978897,
      "pose_mae_dy": 0.09067954123020172,
      "pose_rmse_dtheta": 0.3248850703239441,
      "pose_rmse_dx": 0.17627401649951935,
      "pose_rmse_dy": 0.1749613732099533,
      "pose_rmse_mean": 0.22537349164485931,
      "rmse_dtheta": 0.04091089218854904,
      "rmse_dx": 0.020139455795288086,
      "rmse_dy": 0.011133851483464241,
      "rmse_mean": 0.024061400443315506,
      "rotation_flip": 0.012121211737394333,
      "sparse_tokens": 12115.0,
      "step": 2867,
      "turn_loss": 0.26250290870666504,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1332466084370935,
      "grad_norm": 0.5876181125640869,
      "learning_rate": 8.737761197965254e-06,
      "loss": 0.1582,
      "mae_dtheta": 0.008858708664774895,
      "mae_dx": 0.0025252089835703373,
      "mae_dy": 0.0015769621822983027,
      "pose_mae_dtheta": 0.06480678915977478,
      "pose_mae_dx": 0.02347719855606556,
      "pose_mae_dy": 0.023031987249851227,
      "pose_rmse_dtheta": 0.1437554955482483,
      "pose_rmse_dx": 0.07147356867790222,
      "pose_rmse_dy": 0.055403873324394226,
      "pose_rmse_mean": 0.09021097421646118,
      "rmse_dtheta": 0.019130075350403786,
      "rmse_dx": 0.0083258505910635,
      "rmse_dy": 0.00426934938877821,
      "rmse_mean": 0.010575092397630215,
      "rotation_flip": 0.002601456828415394,
      "sparse_tokens": 32073.0,
      "step": 2868,
      "turn_loss": 0.08382432907819748,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.13329306820293627,
      "grad_norm": 1.0055779218673706,
      "learning_rate": 8.736882845346906e-06,
      "loss": 0.1396,
      "mae_dtheta": 0.05605059862136841,
      "mae_dx": 0.03069920279085636,
      "mae_dy": 0.024648210033774376,
      "pose_mae_dtheta": 0.4939306378364563,
      "pose_mae_dx": 0.2578587532043457,
      "pose_mae_dy": 0.2658937871456146,
      "pose_rmse_dtheta": 0.7671121954917908,
      "pose_rmse_dx": 0.4171423017978668,
      "pose_rmse_dy": 0.3855701982975006,
      "pose_rmse_mean": 0.5232748985290527,
      "rmse_dtheta": 0.07029091566801071,
      "rmse_dx": 0.04309770464897156,
      "rmse_dy": 0.03255448490381241,
      "rmse_mean": 0.04864770174026489,
      "rotation_flip": 0.0069444444961845875,
      "sparse_tokens": 2172.0,
      "step": 2869,
      "turn_loss": 0.9306211471557617,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 20710.0,
      "epoch": 0.13333952796877904,
      "grad_norm": 0.5632661581039429,
      "learning_rate": 8.736004231406335e-06,
      "loss": 0.0992,
      "mae_dtheta": 0.028417477384209633,
      "mae_dx": 0.01294498611241579,
      "mae_dy": 0.004680882208049297,
      "pose_mae_dtheta": 0.22954872250556946,
      "pose_mae_dx": 0.11070603132247925,
      "pose_mae_dy": 0.07311870902776718,
      "pose_rmse_dtheta": 0.3944808542728424,
      "pose_rmse_dx": 0.24754761159420013,
      "pose_rmse_dy": 0.15913383662700653,
      "pose_rmse_mean": 0.26705411076545715,
      "rmse_dtheta": 0.0424734465777874,
      "rmse_dx": 0.026140525937080383,
      "rmse_dy": 0.008432087488472462,
      "rmse_mean": 0.02568202279508114,
      "rotation_flip": 0.017006803303956985,
      "sparse_tokens": 16812.0,
      "step": 2870,
      "turn_loss": 0.22906848788261414,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13338598773462182,
      "grad_norm": 0.7287822961807251,
      "learning_rate": 8.735125356204982e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.016046548262238503,
      "mae_dx": 0.0032622837461531162,
      "mae_dy": 0.005043155048042536,
      "pose_mae_dtheta": 0.12216756492853165,
      "pose_mae_dx": 0.044361796230077744,
      "pose_mae_dy": 0.0475463829934597,
      "pose_rmse_dtheta": 0.30171748995780945,
      "pose_rmse_dx": 0.1216888502240181,
      "pose_rmse_dy": 0.12027294188737869,
      "pose_rmse_mean": 0.1812264323234558,
      "rmse_dtheta": 0.03466927632689476,
      "rmse_dx": 0.009261848405003548,
      "rmse_dy": 0.013369682244956493,
      "rmse_mean": 0.01910027116537094,
      "rotation_flip": 0.005559673998504877,
      "sparse_tokens": 32089.0,
      "step": 2871,
      "turn_loss": 0.14163506031036377,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1334324475004646,
      "grad_norm": 0.5434388518333435,
      "learning_rate": 8.734246219804307e-06,
      "loss": 0.1672,
      "mae_dtheta": 0.007565286476165056,
      "mae_dx": 0.002394312061369419,
      "mae_dy": 0.0016852448461577296,
      "pose_mae_dtheta": 0.056170735508203506,
      "pose_mae_dx": 0.019104165956377983,
      "pose_mae_dy": 0.015818659216165543,
      "pose_rmse_dtheta": 0.20227524638175964,
      "pose_rmse_dx": 0.0640626922249794,
      "pose_rmse_dy": 0.057319458574056625,
      "pose_rmse_mean": 0.10788580030202866,
      "rmse_dtheta": 0.023594392463564873,
      "rmse_dx": 0.008036539889872074,
      "rmse_dy": 0.006867126561701298,
      "rmse_mean": 0.012832686305046082,
      "rotation_flip": 0.0032916392665356398,
      "sparse_tokens": 32137.0,
      "step": 2872,
      "turn_loss": 0.07393168658018112,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.13347890726630737,
      "grad_norm": 1.3002382516860962,
      "learning_rate": 8.733366822265789e-06,
      "loss": 0.289,
      "mae_dtheta": 0.03342275321483612,
      "mae_dx": 0.01085665449500084,
      "mae_dy": 0.004485285375267267,
      "pose_mae_dtheta": 0.26061445474624634,
      "pose_mae_dx": 0.07916128635406494,
      "pose_mae_dy": 0.052638906985521317,
      "pose_rmse_dtheta": 0.46756359934806824,
      "pose_rmse_dx": 0.18865644931793213,
      "pose_rmse_dy": 0.15071138739585876,
      "pose_rmse_mean": 0.26897716522216797,
      "rmse_dtheta": 0.052205756306648254,
      "rmse_dx": 0.022222936153411865,
      "rmse_dy": 0.012003171257674694,
      "rmse_mean": 0.028810620307922363,
      "rotation_flip": 0.012841091491281986,
      "sparse_tokens": 11370.0,
      "step": 2873,
      "turn_loss": 0.2437596321105957,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.13352536703215015,
      "grad_norm": 0.8962215185165405,
      "learning_rate": 8.732487163650929e-06,
      "loss": 0.1797,
      "mae_dtheta": 0.027904970571398735,
      "mae_dx": 0.01268229354172945,
      "mae_dy": 0.006280976813286543,
      "pose_mae_dtheta": 0.21268640458583832,
      "pose_mae_dx": 0.08792456239461899,
      "pose_mae_dy": 0.06077665463089943,
      "pose_rmse_dtheta": 0.3718004524707794,
      "pose_rmse_dx": 0.23774562776088715,
      "pose_rmse_dy": 0.13605302572250366,
      "pose_rmse_mean": 0.24853304028511047,
      "rmse_dtheta": 0.04425656422972679,
      "rmse_dx": 0.02660002000629902,
      "rmse_dy": 0.013844598084688187,
      "rmse_mean": 0.028233727440238,
      "rotation_flip": 0.004140786826610565,
      "sparse_tokens": 8623.0,
      "step": 2874,
      "turn_loss": 0.2672668993473053,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.13357182679799293,
      "grad_norm": 0.61629319190979,
      "learning_rate": 8.731607244021236e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.02409183606505394,
      "mae_dx": 0.00707412650808692,
      "mae_dy": 0.005245789885520935,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6162932515144348,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.50619506835938,
      "model/head/act_norm_mean": 107.22550241570724,
      "model/head/act_norm_min": 76.81303405761719,
      "model/head/act_over_embed": 73.68636912104373,
      "model/head/grad_frac": 0.10443561524152756,
      "model/head/grad_norm": 0.06436296552419662,
      "model/head/grad_zero_frac": 0.00016149133443832397,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.671618009868421,
      "model/head/update_ratio": 0.0011114440858364105,
      "model/head/weight_delta": 6.259994029998779,
      "model/head/weight_delta_rel": 0.10981883853673935,
      "model/head/weight_norm": 57.9093132019043,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4158686697483063,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4158012194511218,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41574639081954956,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28574249079915937,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10458751767873764,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06445658206939697,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5423177083333334,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002091905800625682,
      "model/modality_embedder.encoders.pose/weight_delta": 2.0561773777008057,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06718172132968903,
      "model/modality_embedder.encoders.pose/weight_norm": 30.8123722076416,
      "model/modality_embedder/grad_frac": 0.10458751767873764,
      "model/modality_embedder/grad_norm": 0.06445658206939697,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5423177083333334,
      "model/modality_embedder/update_ratio": 0.002091905800625682,
      "model/modality_embedder/weight_delta": 2.0561773777008057,
      "model/modality_embedder/weight_delta_rel": 0.06718172132968903,
      "model/modality_embedder/weight_norm": 30.8123722076416,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.7840576171875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.34842640455305,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.111776351928711,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.04525721662082,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08637618273496628,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.053233057260513306,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019237467786297202,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.35841703414917,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04950153827667236,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.671550750732422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.17520141601562,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.28466348162072,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.84598159790039,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.688648101171335,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08690455555915833,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05355869233608246,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018290446605533361,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.7054401636123657,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.059077780693769455,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.282331466674805,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.81843566894531,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.040477169486216,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.27898120880127,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.89525970565924,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09379329532384872,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.057804174721241,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019125092076137662,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.8265843391418457,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06133328378200531,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.224260330200195,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 75.81380462646484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.967767726608187,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.306543350219727,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.219711820091934,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11549724638462067,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07118017226457596,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002406544052064419,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.5572688579559326,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05322005972266197,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.577756881713867,
      "model/normalizer/grad_frac": 0.4792296290397644,
      "model/normalizer/grad_norm": 0.2953459918498993,
      "model/normalizer/grad_zero_frac": 0.00017489728634245694,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0037812073715031147,
      "model/normalizer/weight_delta": 3.3196797370910645,
      "model/normalizer/weight_delta_rel": 0.042755551636219025,
      "model/normalizer/weight_norm": 78.1089096069336,
      "pose_mae_dtheta": 0.17397387325763702,
      "pose_mae_dx": 0.06864327937364578,
      "pose_mae_dy": 0.04951440542936325,
      "pose_rmse_dtheta": 0.28851625323295593,
      "pose_rmse_dx": 0.1373833268880844,
      "pose_rmse_dy": 0.10901810973882675,
      "pose_rmse_mean": 0.17830589413642883,
      "rmse_dtheta": 0.04033670946955681,
      "rmse_dx": 0.015199542045593262,
      "rmse_dy": 0.011866658926010132,
      "rmse_mean": 0.022467639297246933,
      "rotation_flip": 0.015358361415565014,
      "sparse_tokens": 10639.0,
      "step": 2875,
      "turn_loss": 0.2465735524892807,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13361828656383573,
      "grad_norm": 0.6880649924278259,
      "learning_rate": 8.730727063438246e-06,
      "loss": 0.1437,
      "mae_dtheta": 0.013605209067463875,
      "mae_dx": 0.002006320748478174,
      "mae_dy": 0.002682785503566265,
      "pose_mae_dtheta": 0.09496790170669556,
      "pose_mae_dx": 0.02746639959514141,
      "pose_mae_dy": 0.03805409371852875,
      "pose_rmse_dtheta": 0.19404520094394684,
      "pose_rmse_dx": 0.0622229129076004,
      "pose_rmse_dy": 0.08246458321809769,
      "pose_rmse_mean": 0.11291089653968811,
      "rmse_dtheta": 0.025850774720311165,
      "rmse_dx": 0.005525345914065838,
      "rmse_dy": 0.005160660482943058,
      "rmse_mean": 0.012178926728665829,
      "rotation_flip": 0.0034937888849526644,
      "sparse_tokens": 32089.0,
      "step": 2876,
      "turn_loss": 0.09706510603427887,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.1336647463296785,
      "grad_norm": 0.6279777884483337,
      "learning_rate": 8.72984662196351e-06,
      "loss": 0.1172,
      "mae_dtheta": 0.030041543766856194,
      "mae_dx": 0.008900578133761883,
      "mae_dy": 0.003844442078843713,
      "pose_mae_dtheta": 0.23403170704841614,
      "pose_mae_dx": 0.06374071538448334,
      "pose_mae_dy": 0.04521937295794487,
      "pose_rmse_dtheta": 0.42923811078071594,
      "pose_rmse_dx": 0.16150341928005219,
      "pose_rmse_dy": 0.10163575410842896,
      "pose_rmse_mean": 0.23079243302345276,
      "rmse_dtheta": 0.049549832940101624,
      "rmse_dx": 0.0204604621976614,
      "rmse_dy": 0.0072181131690740585,
      "rmse_mean": 0.025742804631590843,
      "rotation_flip": 0.00800000037997961,
      "sparse_tokens": 7196.0,
      "step": 2877,
      "turn_loss": 0.24640731513500214,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.13371120609552128,
      "grad_norm": 0.4652412533760071,
      "learning_rate": 8.728965919658597e-06,
      "loss": 0.0895,
      "mae_dtheta": 0.010855056345462799,
      "mae_dx": 0.0022671010810881853,
      "mae_dy": 0.0031765997409820557,
      "pose_mae_dtheta": 0.0734914168715477,
      "pose_mae_dx": 0.03134097531437874,
      "pose_mae_dy": 0.03184211999177933,
      "pose_rmse_dtheta": 0.18707916140556335,
      "pose_rmse_dx": 0.08442306518554688,
      "pose_rmse_dy": 0.07118438184261322,
      "pose_rmse_mean": 0.11422886699438095,
      "rmse_dtheta": 0.02315363846719265,
      "rmse_dx": 0.0062217433005571365,
      "rmse_dy": 0.007179222069680691,
      "rmse_mean": 0.012184868566691875,
      "rotation_flip": 0.009854326955974102,
      "sparse_tokens": 32073.0,
      "step": 2878,
      "turn_loss": 0.09359283000230789,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.13375766586136406,
      "grad_norm": 0.44844913482666016,
      "learning_rate": 8.728084956585097e-06,
      "loss": 0.1213,
      "mae_dtheta": 0.0139795346185565,
      "mae_dx": 0.003121657995507121,
      "mae_dy": 0.004714799579232931,
      "pose_mae_dtheta": 0.09770988672971725,
      "pose_mae_dx": 0.04019328951835632,
      "pose_mae_dy": 0.04314238205552101,
      "pose_rmse_dtheta": 0.179762601852417,
      "pose_rmse_dx": 0.08897534012794495,
      "pose_rmse_dy": 0.09816336631774902,
      "pose_rmse_mean": 0.12230043858289719,
      "rmse_dtheta": 0.02588270604610443,
      "rmse_dx": 0.007278471253812313,
      "rmse_dy": 0.009582018479704857,
      "rmse_mean": 0.014247733168303967,
      "rotation_flip": 0.006842923816293478,
      "sparse_tokens": 32185.0,
      "step": 2879,
      "turn_loss": 0.13812659680843353,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.13380412562720684,
      "grad_norm": 0.5644300580024719,
      "learning_rate": 8.727203732804615e-06,
      "loss": 0.1559,
      "mae_dtheta": 0.00898935180157423,
      "mae_dx": 0.0020845255348831415,
      "mae_dy": 0.0021134207490831614,
      "pose_mae_dtheta": 0.0638679713010788,
      "pose_mae_dx": 0.021536627784371376,
      "pose_mae_dy": 0.02469458244740963,
      "pose_rmse_dtheta": 0.13178865611553192,
      "pose_rmse_dx": 0.053632259368896484,
      "pose_rmse_dy": 0.05217939242720604,
      "pose_rmse_mean": 0.07920010387897491,
      "rmse_dtheta": 0.018374433740973473,
      "rmse_dx": 0.006144026760011911,
      "rmse_dy": 0.00514704454690218,
      "rmse_mean": 0.009888501837849617,
      "rotation_flip": 0.005345211364328861,
      "sparse_tokens": 32121.0,
      "step": 2880,
      "turn_loss": 0.08534813672304153,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.13385058539304961,
      "grad_norm": 0.6422001123428345,
      "learning_rate": 8.726322248378775e-06,
      "loss": 0.1073,
      "mae_dtheta": 0.03133410960435867,
      "mae_dx": 0.012355108745396137,
      "mae_dy": 0.0063874376937747,
      "pose_mae_dtheta": 0.2421877533197403,
      "pose_mae_dx": 0.09583956003189087,
      "pose_mae_dy": 0.10901512950658798,
      "pose_rmse_dtheta": 0.43251827359199524,
      "pose_rmse_dx": 0.22857992351055145,
      "pose_rmse_dy": 0.23048590123653412,
      "pose_rmse_mean": 0.2971947193145752,
      "rmse_dtheta": 0.046152304857969284,
      "rmse_dx": 0.026340270414948463,
      "rmse_dy": 0.010121544823050499,
      "rmse_mean": 0.02753804251551628,
      "rotation_flip": 0.019855596125125885,
      "sparse_tokens": 8955.0,
      "step": 2881,
      "turn_loss": 0.26826679706573486,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.1338970451588924,
      "grad_norm": 0.7519201636314392,
      "learning_rate": 8.72544050336922e-06,
      "loss": 0.153,
      "mae_dtheta": 0.02704053744673729,
      "mae_dx": 0.015690471976995468,
      "mae_dy": 0.0050153909251093864,
      "pose_mae_dtheta": 0.21327604353427887,
      "pose_mae_dx": 0.13105283677577972,
      "pose_mae_dy": 0.08911488950252533,
      "pose_rmse_dtheta": 0.3237939476966858,
      "pose_rmse_dx": 0.3083922564983368,
      "pose_rmse_dy": 0.18058815598487854,
      "pose_rmse_mean": 0.27092477679252625,
      "rmse_dtheta": 0.03997528925538063,
      "rmse_dx": 0.03127982094883919,
      "rmse_dy": 0.00876485276967287,
      "rmse_mean": 0.026673322543501854,
      "rotation_flip": 0.012605042196810246,
      "sparse_tokens": 11144.0,
      "step": 2882,
      "turn_loss": 0.2305224984884262,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.13394350492473517,
      "grad_norm": 0.8156079649925232,
      "learning_rate": 8.724558497837609e-06,
      "loss": 0.1331,
      "mae_dtheta": 0.022886451333761215,
      "mae_dx": 0.007667127531021833,
      "mae_dy": 0.002596264472231269,
      "pose_mae_dtheta": 0.1519140899181366,
      "pose_mae_dx": 0.047388091683387756,
      "pose_mae_dy": 0.03755439817905426,
      "pose_rmse_dtheta": 0.32892388105392456,
      "pose_rmse_dx": 0.1318976879119873,
      "pose_rmse_dy": 0.09517448395490646,
      "pose_rmse_mean": 0.1853320300579071,
      "rmse_dtheta": 0.0431458055973053,
      "rmse_dx": 0.01894649676978588,
      "rmse_dy": 0.005737231578677893,
      "rmse_mean": 0.02260984480381012,
      "rotation_flip": 0.007194244768470526,
      "sparse_tokens": 5446.0,
      "step": 2883,
      "turn_loss": 0.1558375358581543,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.13398996469057797,
      "grad_norm": 0.4467412829399109,
      "learning_rate": 8.723676231845625e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.022918783128261566,
      "mae_dx": 0.010797057300806046,
      "mae_dy": 0.004013205412775278,
      "pose_mae_dtheta": 0.17374934256076813,
      "pose_mae_dx": 0.09435524791479111,
      "pose_mae_dy": 0.06384207308292389,
      "pose_rmse_dtheta": 0.312204509973526,
      "pose_rmse_dx": 0.22652453184127808,
      "pose_rmse_dy": 0.1418326497077942,
      "pose_rmse_mean": 0.22685390710830688,
      "rmse_dtheta": 0.038458604365587234,
      "rmse_dx": 0.0243645291775465,
      "rmse_dy": 0.008672992698848248,
      "rmse_mean": 0.023832041770219803,
      "rotation_flip": 0.007231405004858971,
      "sparse_tokens": 21128.0,
      "step": 2884,
      "turn_loss": 0.16563865542411804,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13403642445642075,
      "grad_norm": 0.4645231366157532,
      "learning_rate": 8.722793705454966e-06,
      "loss": 0.097,
      "mae_dtheta": 0.008944263681769371,
      "mae_dx": 0.0018174391007050872,
      "mae_dy": 0.001062789116986096,
      "pose_mae_dtheta": 0.06266151368618011,
      "pose_mae_dx": 0.014119785279035568,
      "pose_mae_dy": 0.015152228064835072,
      "pose_rmse_dtheta": 0.18534044921398163,
      "pose_rmse_dx": 0.04397235065698624,
      "pose_rmse_dy": 0.046049948781728745,
      "pose_rmse_mean": 0.09178759157657623,
      "rmse_dtheta": 0.024564441293478012,
      "rmse_dx": 0.006149603985249996,
      "rmse_dy": 0.00338571285828948,
      "rmse_mean": 0.011366586200892925,
      "rotation_flip": 0.0029027576092630625,
      "sparse_tokens": 32089.0,
      "step": 2885,
      "turn_loss": 0.05994143709540367,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.13408288422226353,
      "grad_norm": 0.510396420955658,
      "learning_rate": 8.721910918727342e-06,
      "loss": 0.1429,
      "mae_dtheta": 0.03786376491189003,
      "mae_dx": 0.012967009097337723,
      "mae_dy": 0.00819567684084177,
      "pose_mae_dtheta": 0.32147008180618286,
      "pose_mae_dx": 0.10235943645238876,
      "pose_mae_dy": 0.09579456597566605,
      "pose_rmse_dtheta": 0.5044577121734619,
      "pose_rmse_dx": 0.2206891030073166,
      "pose_rmse_dy": 0.19726425409317017,
      "pose_rmse_mean": 0.3074703812599182,
      "rmse_dtheta": 0.052878327667713165,
      "rmse_dx": 0.026302605867385864,
      "rmse_dy": 0.015224005095660686,
      "rmse_mean": 0.031468313187360764,
      "rotation_flip": 0.01315789483487606,
      "sparse_tokens": 12971.0,
      "step": 2886,
      "turn_loss": 0.39622777700424194,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 1336.0,
      "epoch": 0.1341293439881063,
      "grad_norm": 0.7834784388542175,
      "learning_rate": 8.72102787172449e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.04100216180086136,
      "mae_dx": 0.03458992391824722,
      "mae_dy": 0.01904476061463356,
      "pose_mae_dtheta": 0.23514233529567719,
      "pose_mae_dx": 0.23949988186359406,
      "pose_mae_dy": 0.18896162509918213,
      "pose_rmse_dtheta": 0.3169862627983093,
      "pose_rmse_dx": 0.37990275025367737,
      "pose_rmse_dy": 0.33890247344970703,
      "pose_rmse_mean": 0.34526383876800537,
      "rmse_dtheta": 0.05115169286727905,
      "rmse_dx": 0.0465874969959259,
      "rmse_dy": 0.02616153471171856,
      "rmse_mean": 0.04130024462938309,
      "rotation_flip": 0.0,
      "sparse_tokens": 1116.0,
      "step": 2887,
      "turn_loss": 0.7918415069580078,
      "turns": 4.0,
      "turns_per_sample": 4.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.13417580375394908,
      "grad_norm": 0.6014814972877502,
      "learning_rate": 8.720144564508164e-06,
      "loss": 0.0762,
      "mae_dtheta": 0.0045205969363451,
      "mae_dx": 0.0015870978822931647,
      "mae_dy": 0.0009034693357534707,
      "pose_mae_dtheta": 0.031637005507946014,
      "pose_mae_dx": 0.016501380130648613,
      "pose_mae_dy": 0.011357241310179234,
      "pose_rmse_dtheta": 0.1014048308134079,
      "pose_rmse_dx": 0.058628253638744354,
      "pose_rmse_dy": 0.02972440980374813,
      "pose_rmse_mean": 0.06325249373912811,
      "rmse_dtheta": 0.013497463427484035,
      "rmse_dx": 0.006129242479801178,
      "rmse_dy": 0.002485708799213171,
      "rmse_mean": 0.0073708053678274155,
      "rotation_flip": 0.0008849557489156723,
      "sparse_tokens": 32041.0,
      "step": 2888,
      "turn_loss": 0.039684444665908813,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.13422226351979186,
      "grad_norm": 0.6389087438583374,
      "learning_rate": 8.719260997140128e-06,
      "loss": 0.1162,
      "mae_dtheta": 0.010772754438221455,
      "mae_dx": 0.0018390871118754148,
      "mae_dy": 0.0024868000764399767,
      "pose_mae_dtheta": 0.08028057217597961,
      "pose_mae_dx": 0.021509908139705658,
      "pose_mae_dy": 0.029526425525546074,
      "pose_rmse_dtheta": 0.21832682192325592,
      "pose_rmse_dx": 0.06129097193479538,
      "pose_rmse_dy": 0.08547965437173843,
      "pose_rmse_mean": 0.12169914692640305,
      "rmse_dtheta": 0.025057028979063034,
      "rmse_dx": 0.0061628250405192375,
      "rmse_dy": 0.007090217433869839,
      "rmse_mean": 0.012770025059580803,
      "rotation_flip": 0.002163331490010023,
      "sparse_tokens": 32041.0,
      "step": 2889,
      "turn_loss": 0.08290104568004608,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.13426872328563463,
      "grad_norm": 0.554915726184845,
      "learning_rate": 8.718377169682177e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.03776486590504646,
      "mae_dx": 0.009499620646238327,
      "mae_dy": 0.0041131977923214436,
      "pose_mae_dtheta": 0.3294270634651184,
      "pose_mae_dx": 0.06774479895830154,
      "pose_mae_dy": 0.05266549065709114,
      "pose_rmse_dtheta": 0.5882142186164856,
      "pose_rmse_dx": 0.14822934567928314,
      "pose_rmse_dy": 0.11642447859048843,
      "pose_rmse_mean": 0.2842893600463867,
      "rmse_dtheta": 0.059366434812545776,
      "rmse_dx": 0.01824239268898964,
      "rmse_dy": 0.0071241967380046844,
      "rmse_mean": 0.028244342654943466,
      "rotation_flip": 0.013333333656191826,
      "sparse_tokens": 5297.0,
      "step": 2890,
      "turn_loss": 0.20952384173870087,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1343151830514774,
      "grad_norm": 0.42112961411476135,
      "learning_rate": 8.717493082196114e-06,
      "loss": 0.0845,
      "mae_dtheta": 0.006172521505504847,
      "mae_dx": 0.001624225522391498,
      "mae_dy": 0.0005294529837556183,
      "pose_mae_dtheta": 0.04752760007977486,
      "pose_mae_dx": 0.013616733253002167,
      "pose_mae_dy": 0.006966608576476574,
      "pose_rmse_dtheta": 0.21501995623111725,
      "pose_rmse_dx": 0.041019439697265625,
      "pose_rmse_dy": 0.025638770312070847,
      "pose_rmse_mean": 0.09389271587133408,
      "rmse_dtheta": 0.024086983874440193,
      "rmse_dx": 0.004882069304585457,
      "rmse_dy": 0.0014468096196651459,
      "rmse_mean": 0.010138621553778648,
      "rotation_flip": 0.001693480066023767,
      "sparse_tokens": 32137.0,
      "step": 2891,
      "turn_loss": 0.040899667888879776,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.1343616428173202,
      "grad_norm": 0.48295819759368896,
      "learning_rate": 8.716608734743765e-06,
      "loss": 0.1142,
      "mae_dtheta": 0.02171207219362259,
      "mae_dx": 0.009855423122644424,
      "mae_dy": 0.005254076793789864,
      "pose_mae_dtheta": 0.16721875965595245,
      "pose_mae_dx": 0.07427869737148285,
      "pose_mae_dy": 0.05804808437824249,
      "pose_rmse_dtheta": 0.3028099834918976,
      "pose_rmse_dx": 0.21000055968761444,
      "pose_rmse_dy": 0.1240977868437767,
      "pose_rmse_mean": 0.2123027741909027,
      "rmse_dtheta": 0.03787533566355705,
      "rmse_dx": 0.02257991023361683,
      "rmse_dy": 0.011429942212998867,
      "rmse_mean": 0.023961730301380157,
      "rotation_flip": 0.0066225165501236916,
      "sparse_tokens": 10209.0,
      "step": 2892,
      "turn_loss": 0.24989402294158936,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.134408102583163,
      "grad_norm": 0.4536309838294983,
      "learning_rate": 8.715724127386971e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.010266125202178955,
      "mae_dx": 0.001815125928260386,
      "mae_dy": 0.002457398222759366,
      "pose_mae_dtheta": 0.07094728946685791,
      "pose_mae_dx": 0.024354618042707443,
      "pose_mae_dy": 0.029665281996130943,
      "pose_rmse_dtheta": 0.14754299819469452,
      "pose_rmse_dx": 0.05728890001773834,
      "pose_rmse_dy": 0.08076567947864532,
      "pose_rmse_mean": 0.09519919008016586,
      "rmse_dtheta": 0.02136719971895218,
      "rmse_dx": 0.004904288798570633,
      "rmse_dy": 0.00549805024638772,
      "rmse_mean": 0.010589847341179848,
      "rotation_flip": 0.0049486104398965836,
      "sparse_tokens": 32137.0,
      "step": 2893,
      "turn_loss": 0.10247736424207687,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.13445456234900577,
      "grad_norm": 0.511603057384491,
      "learning_rate": 8.714839260187596e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.011714662425220013,
      "mae_dx": 0.002045969245955348,
      "mae_dy": 0.002690589753910899,
      "pose_mae_dtheta": 0.08320297300815582,
      "pose_mae_dx": 0.029878418892621994,
      "pose_mae_dy": 0.04051072150468826,
      "pose_rmse_dtheta": 0.1388343870639801,
      "pose_rmse_dx": 0.06417448818683624,
      "pose_rmse_dy": 0.0849456861615181,
      "pose_rmse_mean": 0.09598486125469208,
      "rmse_dtheta": 0.019393980503082275,
      "rmse_dx": 0.005155735649168491,
      "rmse_dy": 0.004928999580442905,
      "rmse_mean": 0.0098262382671237,
      "rotation_flip": 0.005416384432464838,
      "sparse_tokens": 32169.0,
      "step": 2894,
      "turn_loss": 0.10515189170837402,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.13450102211484855,
      "grad_norm": 0.5513983368873596,
      "learning_rate": 8.713954133207517e-06,
      "loss": 0.1368,
      "mae_dtheta": 0.03320945054292679,
      "mae_dx": 0.01229008100926876,
      "mae_dy": 0.004485085140913725,
      "pose_mae_dtheta": 0.26187029480934143,
      "pose_mae_dx": 0.10063761472702026,
      "pose_mae_dy": 0.056305550038814545,
      "pose_rmse_dtheta": 0.4464491605758667,
      "pose_rmse_dx": 0.2248670607805252,
      "pose_rmse_dy": 0.13409359753131866,
      "pose_rmse_mean": 0.2684699296951294,
      "rmse_dtheta": 0.05154227465391159,
      "rmse_dx": 0.024710092693567276,
      "rmse_dy": 0.009217632003128529,
      "rmse_mean": 0.02849000319838524,
      "rotation_flip": 0.012809564359486103,
      "sparse_tokens": 20203.0,
      "step": 2895,
      "turn_loss": 0.24331259727478027,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.13454748188069132,
      "grad_norm": 0.625648558139801,
      "learning_rate": 8.713068746508633e-06,
      "loss": 0.1681,
      "mae_dtheta": 0.011598844081163406,
      "mae_dx": 0.0020664751064032316,
      "mae_dy": 0.002903619548305869,
      "pose_mae_dtheta": 0.08058584481477737,
      "pose_mae_dx": 0.027044879272580147,
      "pose_mae_dy": 0.031170127913355827,
      "pose_rmse_dtheta": 0.1849820464849472,
      "pose_rmse_dx": 0.06602305173873901,
      "pose_rmse_dy": 0.07403971999883652,
      "pose_rmse_mean": 0.10834828019142151,
      "rmse_dtheta": 0.02494528703391552,
      "rmse_dx": 0.0052586933597922325,
      "rmse_dy": 0.005876631010323763,
      "rmse_mean": 0.012026870623230934,
      "rotation_flip": 0.005625413730740547,
      "sparse_tokens": 32153.0,
      "step": 2896,
      "turn_loss": 0.10833054035902023,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1345939416465341,
      "grad_norm": 0.7231311202049255,
      "learning_rate": 8.712183100152858e-06,
      "loss": 0.1957,
      "mae_dtheta": 0.016374075785279274,
      "mae_dx": 0.004524508956819773,
      "mae_dy": 0.006155225448310375,
      "pose_mae_dtheta": 0.12291571497917175,
      "pose_mae_dx": 0.05663709342479706,
      "pose_mae_dy": 0.06692870706319809,
      "pose_rmse_dtheta": 0.26060453057289124,
      "pose_rmse_dx": 0.15930995345115662,
      "pose_rmse_dy": 0.18389689922332764,
      "pose_rmse_mean": 0.2012704610824585,
      "rmse_dtheta": 0.031617216765880585,
      "rmse_dx": 0.01310654729604721,
      "rmse_dy": 0.014777138829231262,
      "rmse_mean": 0.019833635538816452,
      "rotation_flip": 0.007052709814161062,
      "sparse_tokens": 32121.0,
      "step": 2897,
      "turn_loss": 0.1921723634004593,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.13464040141237688,
      "grad_norm": 0.49643248319625854,
      "learning_rate": 8.711297194202125e-06,
      "loss": 0.1394,
      "mae_dtheta": 0.042421139776706696,
      "mae_dx": 0.012788121588528156,
      "mae_dy": 0.007885039784014225,
      "pose_mae_dtheta": 0.32748928666114807,
      "pose_mae_dx": 0.09877476096153259,
      "pose_mae_dy": 0.09784132987260818,
      "pose_rmse_dtheta": 0.5213316679000854,
      "pose_rmse_dx": 0.19286218285560608,
      "pose_rmse_dy": 0.1969466656446457,
      "pose_rmse_mean": 0.30371350049972534,
      "rmse_dtheta": 0.05760497227311134,
      "rmse_dx": 0.024113120511174202,
      "rmse_dy": 0.012800406664609909,
      "rmse_mean": 0.031506165862083435,
      "rotation_flip": 0.01295641902834177,
      "sparse_tokens": 13978.0,
      "step": 2898,
      "turn_loss": 0.3386283814907074,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.13468686117821965,
      "grad_norm": 0.5280239582061768,
      "learning_rate": 8.710411028718388e-06,
      "loss": 0.0786,
      "mae_dtheta": 0.008755926974117756,
      "mae_dx": 0.0019143170211464167,
      "mae_dy": 0.0016366064082831144,
      "pose_mae_dtheta": 0.06369266659021378,
      "pose_mae_dx": 0.01740492880344391,
      "pose_mae_dy": 0.021446075290441513,
      "pose_rmse_dtheta": 0.19385795295238495,
      "pose_rmse_dx": 0.06516984850168228,
      "pose_rmse_dy": 0.06261776387691498,
      "pose_rmse_mean": 0.10721518844366074,
      "rmse_dtheta": 0.025480354204773903,
      "rmse_dx": 0.007142998278141022,
      "rmse_dy": 0.005672510713338852,
      "rmse_mean": 0.012765287421643734,
      "rotation_flip": 0.005681818351149559,
      "sparse_tokens": 32153.0,
      "step": 2899,
      "turn_loss": 0.0655934065580368,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13473332094406243,
      "grad_norm": 0.4375850260257721,
      "learning_rate": 8.709524603763617e-06,
      "loss": 0.0787,
      "mae_dtheta": 0.00899625662714243,
      "mae_dx": 0.0014792232541367412,
      "mae_dy": 0.0016324189491569996,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4375849962234497,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.6887664794922,
      "model/head/act_norm_mean": 120.1343020044192,
      "model/head/act_norm_min": 60.582969665527344,
      "model/head/act_over_embed": 82.55741705249241,
      "model/head/grad_frac": 0.11632419377565384,
      "model/head/grad_norm": 0.05090172216296196,
      "model/head/grad_zero_frac": 0.0001443586515961215,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6936799636994949,
      "model/head/update_ratio": 0.0008789023268036544,
      "model/head/weight_delta": 6.288394451141357,
      "model/head/weight_delta_rel": 0.11031706631183624,
      "model/head/weight_norm": 57.91510772705078,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41616925597190857,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.416077695820666,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41600218415260315,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28593248794872267,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06821531802415848,
      "model/modality_embedder.encoders.pose/grad_norm": 0.029850000515580177,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5071143240950227,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009687340352684259,
      "model/modality_embedder.encoders.pose/weight_delta": 2.06099796295166,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.067339226603508,
      "model/modality_embedder.encoders.pose/weight_norm": 30.813411712646484,
      "model/modality_embedder/grad_frac": 0.06821531802415848,
      "model/modality_embedder/grad_norm": 0.029850000515580177,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5071143240950227,
      "model/modality_embedder/update_ratio": 0.0009687340352684259,
      "model/modality_embedder/weight_delta": 2.06099796295166,
      "model/modality_embedder/weight_delta_rel": 0.067339226603508,
      "model/modality_embedder/weight_norm": 30.813411712646484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.18942260742188,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.40454395141895,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.036211967468262,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.77103108235532,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1095118522644043,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.047920744866132736,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017316482262685895,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.3672670125961304,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.04982403665781021,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.673486709594727,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.52261352539062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.434428611511944,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 11.997102737426758,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.478777462703324,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.11009448021650314,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.048175692558288574,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016450323164463043,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.7174999713897705,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05949554219841957,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.285560607910156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.41742706298828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.31433631954465,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.151275634765625,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.770667639636656,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10284026712179184,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04500135779380798,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014887680299580097,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.8389692306518555,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06174914166331291,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.227245330810547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.11044311523438,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.081737514029182,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.347143173217773,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.985242287157106,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11259055882692337,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04926794022321701,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016656325897201896,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.5680612325668335,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05358889326453209,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.579116821289062,
      "model/normalizer/grad_frac": 0.5047508478164673,
      "model/normalizer/grad_norm": 0.22087140381336212,
      "model/normalizer/grad_zero_frac": 0.00015362599515356123,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002827607560902834,
      "model/normalizer/weight_delta": 3.342473030090332,
      "model/normalizer/weight_delta_rel": 0.04304911568760872,
      "model/normalizer/weight_norm": 78.11246490478516,
      "pose_mae_dtheta": 0.06591539829969406,
      "pose_mae_dx": 0.020049789920449257,
      "pose_mae_dy": 0.024992506951093674,
      "pose_rmse_dtheta": 0.18319196999073029,
      "pose_rmse_dx": 0.06152922660112381,
      "pose_rmse_dy": 0.06864374130964279,
      "pose_rmse_mean": 0.10445498675107956,
      "rmse_dtheta": 0.023010563105344772,
      "rmse_dx": 0.0051554408855736256,
      "rmse_dy": 0.00391024025157094,
      "rmse_mean": 0.010692081414163113,
      "rotation_flip": 0.0026413099840283394,
      "sparse_tokens": 32089.0,
      "step": 2900,
      "turn_loss": 0.06306427717208862,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.13477978070990523,
      "grad_norm": 0.6898998022079468,
      "learning_rate": 8.708637919399798e-06,
      "loss": 0.1549,
      "mae_dtheta": 0.00982593186199665,
      "mae_dx": 0.0017427286366000772,
      "mae_dy": 0.0022975909523665905,
      "pose_mae_dtheta": 0.0660262182354927,
      "pose_mae_dx": 0.022114945575594902,
      "pose_mae_dy": 0.029932420700788498,
      "pose_rmse_dtheta": 0.14263717830181122,
      "pose_rmse_dx": 0.055869027972221375,
      "pose_rmse_dy": 0.07080119103193283,
      "pose_rmse_mean": 0.0897691398859024,
      "rmse_dtheta": 0.02166084386408329,
      "rmse_dx": 0.005398663692176342,
      "rmse_dy": 0.005220943130552769,
      "rmse_mean": 0.010760149918496609,
      "rotation_flip": 0.009136592037975788,
      "sparse_tokens": 32073.0,
      "step": 2901,
      "turn_loss": 0.08753341436386108,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.134826240475748,
      "grad_norm": 0.4566403925418854,
      "learning_rate": 8.70775097568894e-06,
      "loss": 0.0956,
      "mae_dtheta": 0.015122408978641033,
      "mae_dx": 0.0035394150763750076,
      "mae_dy": 0.005390134174376726,
      "pose_mae_dtheta": 0.12207082659006119,
      "pose_mae_dx": 0.05358845740556717,
      "pose_mae_dy": 0.05890274420380592,
      "pose_rmse_dtheta": 0.27814897894859314,
      "pose_rmse_dx": 0.1416768729686737,
      "pose_rmse_dy": 0.16774575412273407,
      "pose_rmse_mean": 0.1958572119474411,
      "rmse_dtheta": 0.03103906847536564,
      "rmse_dx": 0.008699586614966393,
      "rmse_dy": 0.0131000354886055,
      "rmse_mean": 0.017612896859645844,
      "rotation_flip": 0.004799451678991318,
      "sparse_tokens": 32137.0,
      "step": 2902,
      "turn_loss": 0.15274880826473236,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27902.0,
      "epoch": 0.1348727002415908,
      "grad_norm": 0.4233575165271759,
      "learning_rate": 8.706863772693067e-06,
      "loss": 0.0991,
      "mae_dtheta": 0.026611432433128357,
      "mae_dx": 0.010862544178962708,
      "mae_dy": 0.003377915360033512,
      "pose_mae_dtheta": 0.21891161799430847,
      "pose_mae_dx": 0.09247708320617676,
      "pose_mae_dy": 0.04785355553030968,
      "pose_rmse_dtheta": 0.36283454298973083,
      "pose_rmse_dx": 0.22191151976585388,
      "pose_rmse_dy": 0.10652568191289902,
      "pose_rmse_mean": 0.2304239124059677,
      "rmse_dtheta": 0.04110182449221611,
      "rmse_dx": 0.023772064596414566,
      "rmse_dy": 0.006723451428115368,
      "rmse_mean": 0.023865779861807823,
      "rotation_flip": 0.01154734380543232,
      "sparse_tokens": 22310.0,
      "step": 2903,
      "turn_loss": 0.2079910933971405,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.13491916000743356,
      "grad_norm": 0.45510056614875793,
      "learning_rate": 8.705976310474218e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.0328669473528862,
      "mae_dx": 0.013688451610505581,
      "mae_dy": 0.0052858153358101845,
      "pose_mae_dtheta": 0.2596573233604431,
      "pose_mae_dx": 0.12643760442733765,
      "pose_mae_dy": 0.07735609263181686,
      "pose_rmse_dtheta": 0.40901148319244385,
      "pose_rmse_dx": 0.28386950492858887,
      "pose_rmse_dy": 0.14398904144763947,
      "pose_rmse_mean": 0.27895668148994446,
      "rmse_dtheta": 0.04784098640084267,
      "rmse_dx": 0.02784191258251667,
      "rmse_dy": 0.008533530868589878,
      "rmse_mean": 0.028072144836187363,
      "rotation_flip": 0.015789473429322243,
      "sparse_tokens": 6324.0,
      "step": 2904,
      "turn_loss": 0.2691730260848999,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.13496561977327634,
      "grad_norm": 0.4465663731098175,
      "learning_rate": 8.705088589094458e-06,
      "loss": 0.1451,
      "mae_dtheta": 0.009596439078450203,
      "mae_dx": 0.0023702229373157024,
      "mae_dy": 0.0020009768195450306,
      "pose_mae_dtheta": 0.06844363361597061,
      "pose_mae_dx": 0.0253779087215662,
      "pose_mae_dy": 0.019344506785273552,
      "pose_rmse_dtheta": 0.17798858880996704,
      "pose_rmse_dx": 0.06279900670051575,
      "pose_rmse_dy": 0.04997950792312622,
      "pose_rmse_mean": 0.096922367811203,
      "rmse_dtheta": 0.022889647632837296,
      "rmse_dx": 0.006353575736284256,
      "rmse_dy": 0.00539977103471756,
      "rmse_mean": 0.011547665111720562,
      "rotation_flip": 0.0022140222135931253,
      "sparse_tokens": 32217.0,
      "step": 2905,
      "turn_loss": 0.08284348994493484,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.13501207953911912,
      "grad_norm": 0.38274332880973816,
      "learning_rate": 8.704200608615865e-06,
      "loss": 0.1042,
      "mae_dtheta": 0.008827722631394863,
      "mae_dx": 0.002078109886497259,
      "mae_dy": 0.0023955265060067177,
      "pose_mae_dtheta": 0.06343575567007065,
      "pose_mae_dx": 0.02154656872153282,
      "pose_mae_dy": 0.022882040590047836,
      "pose_rmse_dtheta": 0.1455933153629303,
      "pose_rmse_dx": 0.05107565224170685,
      "pose_rmse_dy": 0.05158000811934471,
      "pose_rmse_mean": 0.08274966478347778,
      "rmse_dtheta": 0.018935363739728928,
      "rmse_dx": 0.006216528359800577,
      "rmse_dy": 0.006511869374662638,
      "rmse_mean": 0.010554587468504906,
      "rotation_flip": 0.005080440081655979,
      "sparse_tokens": 32121.0,
      "step": 2906,
      "turn_loss": 0.0880880057811737,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1350585393049619,
      "grad_norm": 0.6059461236000061,
      "learning_rate": 8.703312369100536e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.011978352442383766,
      "mae_dx": 0.0024627498351037502,
      "mae_dy": 0.002493643667548895,
      "pose_mae_dtheta": 0.07607981562614441,
      "pose_mae_dx": 0.026105782017111778,
      "pose_mae_dy": 0.026808785274624825,
      "pose_rmse_dtheta": 0.1790262907743454,
      "pose_rmse_dx": 0.05988779291510582,
      "pose_rmse_dy": 0.05927342176437378,
      "pose_rmse_mean": 0.09939583390951157,
      "rmse_dtheta": 0.02448192611336708,
      "rmse_dx": 0.006764350924640894,
      "rmse_dy": 0.005320209078490734,
      "rmse_mean": 0.01218882855027914,
      "rotation_flip": 0.005269100423902273,
      "sparse_tokens": 32137.0,
      "step": 2907,
      "turn_loss": 0.10495041310787201,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.13510499907080467,
      "grad_norm": 0.46924710273742676,
      "learning_rate": 8.702423870610583e-06,
      "loss": 0.0984,
      "mae_dtheta": 0.01663643680512905,
      "mae_dx": 0.003248904598876834,
      "mae_dy": 0.00512466998770833,
      "pose_mae_dtheta": 0.11744847148656845,
      "pose_mae_dx": 0.04716624319553375,
      "pose_mae_dy": 0.05243702605366707,
      "pose_rmse_dtheta": 0.22939737141132355,
      "pose_rmse_dx": 0.11829022318124771,
      "pose_rmse_dy": 0.11737532913684845,
      "pose_rmse_mean": 0.15502098202705383,
      "rmse_dtheta": 0.0288119837641716,
      "rmse_dx": 0.009117611683905125,
      "rmse_dy": 0.01051893550902605,
      "rmse_mean": 0.016149509698152542,
      "rotation_flip": 0.006170723121613264,
      "sparse_tokens": 32073.0,
      "step": 2908,
      "turn_loss": 0.16039764881134033,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.13515145883664748,
      "grad_norm": 0.404438316822052,
      "learning_rate": 8.701535113208144e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.015704724937677383,
      "mae_dx": 0.003204290522262454,
      "mae_dy": 0.0039807637222111225,
      "pose_mae_dtheta": 0.1156737357378006,
      "pose_mae_dx": 0.037980809807777405,
      "pose_mae_dy": 0.050646472722291946,
      "pose_rmse_dtheta": 0.24122431874275208,
      "pose_rmse_dx": 0.09585946053266525,
      "pose_rmse_dy": 0.11757629364728928,
      "pose_rmse_mean": 0.15155336260795593,
      "rmse_dtheta": 0.02956985868513584,
      "rmse_dx": 0.009619663469493389,
      "rmse_dy": 0.008794927038252354,
      "rmse_mean": 0.01599481701850891,
      "rotation_flip": 0.005893909838050604,
      "sparse_tokens": 32137.0,
      "step": 2909,
      "turn_loss": 0.1416919231414795,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13519791860249025,
      "grad_norm": 0.7169273495674133,
      "learning_rate": 8.700646096955366e-06,
      "loss": 0.1763,
      "mae_dtheta": 0.012880063615739346,
      "mae_dx": 0.0017721231561154127,
      "mae_dy": 0.002805854193866253,
      "pose_mae_dtheta": 0.09227760881185532,
      "pose_mae_dx": 0.025621948763728142,
      "pose_mae_dy": 0.040317974984645844,
      "pose_rmse_dtheta": 0.2017323523759842,
      "pose_rmse_dx": 0.06903158128261566,
      "pose_rmse_dy": 0.08999013155698776,
      "pose_rmse_mean": 0.1202513575553894,
      "rmse_dtheta": 0.025782298296689987,
      "rmse_dx": 0.005223060958087444,
      "rmse_dy": 0.006222030613571405,
      "rmse_mean": 0.012409131042659283,
      "rotation_flip": 0.002487562131136656,
      "sparse_tokens": 32089.0,
      "step": 2910,
      "turn_loss": 0.09169324487447739,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.13524437836833303,
      "grad_norm": 0.5847772359848022,
      "learning_rate": 8.69975682191442e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.011895351111888885,
      "mae_dx": 0.0035206738393753767,
      "mae_dy": 0.003153726691380143,
      "pose_mae_dtheta": 0.07865951955318451,
      "pose_mae_dx": 0.038239650428295135,
      "pose_mae_dy": 0.03624321520328522,
      "pose_rmse_dtheta": 0.18205797672271729,
      "pose_rmse_dx": 0.10695666074752808,
      "pose_rmse_dy": 0.0860774889588356,
      "pose_rmse_mean": 0.12503071129322052,
      "rmse_dtheta": 0.024872468784451485,
      "rmse_dx": 0.011110296472907066,
      "rmse_dy": 0.007171562407165766,
      "rmse_mean": 0.01438477635383606,
      "rotation_flip": 0.005326231475919485,
      "sparse_tokens": 32057.0,
      "step": 2911,
      "turn_loss": 0.10700765997171402,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.1352908381341758,
      "grad_norm": 0.5638365745544434,
      "learning_rate": 8.698867288147495e-06,
      "loss": 0.1774,
      "mae_dtheta": 0.03309124335646629,
      "mae_dx": 0.012111627496778965,
      "mae_dy": 0.008473389782011509,
      "pose_mae_dtheta": 0.2582605183124542,
      "pose_mae_dx": 0.09297491610050201,
      "pose_mae_dy": 0.09757125377655029,
      "pose_rmse_dtheta": 0.5086790323257446,
      "pose_rmse_dx": 0.20372985303401947,
      "pose_rmse_dy": 0.20528773963451385,
      "pose_rmse_mean": 0.30589890480041504,
      "rmse_dtheta": 0.05271930247545242,
      "rmse_dx": 0.025184767320752144,
      "rmse_dy": 0.018137803301215172,
      "rmse_mean": 0.03201396018266678,
      "rotation_flip": 0.018930958583950996,
      "sparse_tokens": 16208.0,
      "step": 2912,
      "turn_loss": 0.32755979895591736,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.13533729790001858,
      "grad_norm": 0.5074162483215332,
      "learning_rate": 8.697977495716794e-06,
      "loss": 0.111,
      "mae_dtheta": 0.03604608401656151,
      "mae_dx": 0.010687606409192085,
      "mae_dy": 0.004544123541563749,
      "pose_mae_dtheta": 0.2799963057041168,
      "pose_mae_dx": 0.10587793588638306,
      "pose_mae_dy": 0.07244322448968887,
      "pose_rmse_dtheta": 0.4982512295246124,
      "pose_rmse_dx": 0.21526530385017395,
      "pose_rmse_dy": 0.16613329946994781,
      "pose_rmse_mean": 0.29321661591529846,
      "rmse_dtheta": 0.05324019864201546,
      "rmse_dx": 0.021765567362308502,
      "rmse_dy": 0.008328080177307129,
      "rmse_mean": 0.02777795121073723,
      "rotation_flip": 0.018099548295140266,
      "sparse_tokens": 11124.0,
      "step": 2913,
      "turn_loss": 0.24035103619098663,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13538375766586136,
      "grad_norm": 0.5627114772796631,
      "learning_rate": 8.697087444684541e-06,
      "loss": 0.1223,
      "mae_dtheta": 0.01606263406574726,
      "mae_dx": 0.002981941681355238,
      "mae_dy": 0.004670569207519293,
      "pose_mae_dtheta": 0.10744308680295944,
      "pose_mae_dx": 0.03702213987708092,
      "pose_mae_dy": 0.051378749310970306,
      "pose_rmse_dtheta": 0.22917550802230835,
      "pose_rmse_dx": 0.09095847606658936,
      "pose_rmse_dy": 0.12923090159893036,
      "pose_rmse_mean": 0.14978830516338348,
      "rmse_dtheta": 0.02930082567036152,
      "rmse_dx": 0.009943190030753613,
      "rmse_dy": 0.010545821860432625,
      "rmse_mean": 0.016596613451838493,
      "rotation_flip": 0.006533812265843153,
      "sparse_tokens": 32089.0,
      "step": 2914,
      "turn_loss": 0.1363145112991333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.13543021743170414,
      "grad_norm": 0.42497318983078003,
      "learning_rate": 8.69619713511298e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.011901654303073883,
      "mae_dx": 0.004312668927013874,
      "mae_dy": 0.004461458418518305,
      "pose_mae_dtheta": 0.08486787974834442,
      "pose_mae_dx": 0.04867519065737724,
      "pose_mae_dy": 0.03849076107144356,
      "pose_rmse_dtheta": 0.18302740156650543,
      "pose_rmse_dx": 0.1405448019504547,
      "pose_rmse_dy": 0.08690048009157181,
      "pose_rmse_mean": 0.13682423532009125,
      "rmse_dtheta": 0.023411964997649193,
      "rmse_dx": 0.01217786967754364,
      "rmse_dy": 0.010423279367387295,
      "rmse_mean": 0.015337705612182617,
      "rotation_flip": 0.006935944315046072,
      "sparse_tokens": 32105.0,
      "step": 2915,
      "turn_loss": 0.1183013916015625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.1354766771975469,
      "grad_norm": 0.7139791250228882,
      "learning_rate": 8.69530656706437e-06,
      "loss": 0.1803,
      "mae_dtheta": 0.04079259932041168,
      "mae_dx": 0.011796708218753338,
      "mae_dy": 0.003081416478380561,
      "pose_mae_dtheta": 0.3129154443740845,
      "pose_mae_dx": 0.09183146059513092,
      "pose_mae_dy": 0.04350655525922775,
      "pose_rmse_dtheta": 0.5174897313117981,
      "pose_rmse_dx": 0.1903068572282791,
      "pose_rmse_dy": 0.09853846579790115,
      "pose_rmse_mean": 0.26877835392951965,
      "rmse_dtheta": 0.058563634753227234,
      "rmse_dx": 0.023562148213386536,
      "rmse_dy": 0.00559338228777051,
      "rmse_mean": 0.029239721596240997,
      "rotation_flip": 0.009244992397725582,
      "sparse_tokens": 11897.0,
      "step": 2916,
      "turn_loss": 0.2997026741504669,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.13552313696338972,
      "grad_norm": 0.637052059173584,
      "learning_rate": 8.69441574060099e-06,
      "loss": 0.1654,
      "mae_dtheta": 0.029060082510113716,
      "mae_dx": 0.00784650631248951,
      "mae_dy": 0.004291899967938662,
      "pose_mae_dtheta": 0.2454129159450531,
      "pose_mae_dx": 0.06095285713672638,
      "pose_mae_dy": 0.034039903432130814,
      "pose_rmse_dtheta": 0.46301013231277466,
      "pose_rmse_dx": 0.1321011781692505,
      "pose_rmse_dy": 0.0659676045179367,
      "pose_rmse_mean": 0.2203596532344818,
      "rmse_dtheta": 0.04797479510307312,
      "rmse_dx": 0.015831708908081055,
      "rmse_dy": 0.007740965113043785,
      "rmse_mean": 0.023849157616496086,
      "rotation_flip": 0.009554140269756317,
      "sparse_tokens": 5781.0,
      "step": 2917,
      "turn_loss": 0.24535176157951355,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1355695967292325,
      "grad_norm": 0.5749750137329102,
      "learning_rate": 8.69352465578513e-06,
      "loss": 0.1162,
      "mae_dtheta": 0.010212677530944347,
      "mae_dx": 0.002440167823806405,
      "mae_dy": 0.002656000666320324,
      "pose_mae_dtheta": 0.07124166935682297,
      "pose_mae_dx": 0.03230693191289902,
      "pose_mae_dy": 0.03148539736866951,
      "pose_rmse_dtheta": 0.153013676404953,
      "pose_rmse_dx": 0.0801968201994896,
      "pose_rmse_dy": 0.08184845745563507,
      "pose_rmse_mean": 0.10501965135335922,
      "rmse_dtheta": 0.02070637419819832,
      "rmse_dx": 0.006463320460170507,
      "rmse_dy": 0.005860956851392984,
      "rmse_mean": 0.011010217480361462,
      "rotation_flip": 0.004735883325338364,
      "sparse_tokens": 32137.0,
      "step": 2918,
      "turn_loss": 0.09432245790958405,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.13561605649507527,
      "grad_norm": 1.3929449319839478,
      "learning_rate": 8.692633312679111e-06,
      "loss": 0.3035,
      "mae_dtheta": 0.03769317641854286,
      "mae_dx": 0.019060680642724037,
      "mae_dy": 0.011152904480695724,
      "pose_mae_dtheta": 0.26327818632125854,
      "pose_mae_dx": 0.15169386565685272,
      "pose_mae_dy": 0.13495489954948425,
      "pose_rmse_dtheta": 0.4206865727901459,
      "pose_rmse_dx": 0.2774397134780884,
      "pose_rmse_dy": 0.27875688672065735,
      "pose_rmse_mean": 0.32562774419784546,
      "rmse_dtheta": 0.05108997970819473,
      "rmse_dx": 0.03092329576611519,
      "rmse_dy": 0.020262379199266434,
      "rmse_mean": 0.03409188613295555,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 5842.0,
      "step": 2919,
      "turn_loss": 0.4873080551624298,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.13566251626091805,
      "grad_norm": 1.105467677116394,
      "learning_rate": 8.691741711345263e-06,
      "loss": 0.283,
      "mae_dtheta": 0.03278271481394768,
      "mae_dx": 0.009170020930469036,
      "mae_dy": 0.007099405396729708,
      "pose_mae_dtheta": 0.236772820353508,
      "pose_mae_dx": 0.09303296357393265,
      "pose_mae_dy": 0.0918760746717453,
      "pose_rmse_dtheta": 0.43804845213890076,
      "pose_rmse_dx": 0.22851957380771637,
      "pose_rmse_dy": 0.285434365272522,
      "pose_rmse_mean": 0.3173341453075409,
      "rmse_dtheta": 0.05058756843209267,
      "rmse_dx": 0.02140362188220024,
      "rmse_dy": 0.015527963638305664,
      "rmse_mean": 0.029173051938414574,
      "rotation_flip": 0.013392857275903225,
      "sparse_tokens": 12689.0,
      "step": 2920,
      "turn_loss": 0.29062241315841675,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.13570897602676082,
      "grad_norm": 0.7251935005187988,
      "learning_rate": 8.690849851845933e-06,
      "loss": 0.1048,
      "mae_dtheta": 0.02677731215953827,
      "mae_dx": 0.01098563801497221,
      "mae_dy": 0.0037257468793541193,
      "pose_mae_dtheta": 0.21265533566474915,
      "pose_mae_dx": 0.07357010990381241,
      "pose_mae_dy": 0.0442405566573143,
      "pose_rmse_dtheta": 0.35913902521133423,
      "pose_rmse_dx": 0.16571426391601562,
      "pose_rmse_dy": 0.11287737637758255,
      "pose_rmse_mean": 0.21257689595222473,
      "rmse_dtheta": 0.04180585592985153,
      "rmse_dx": 0.022080617025494576,
      "rmse_dy": 0.006985595915466547,
      "rmse_mean": 0.02362402342259884,
      "rotation_flip": 0.01886792480945587,
      "sparse_tokens": 7668.0,
      "step": 2921,
      "turn_loss": 0.173326775431633,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.1357554357926036,
      "grad_norm": 0.6042344570159912,
      "learning_rate": 8.689957734243494e-06,
      "loss": 0.1262,
      "mae_dtheta": 0.03498854860663414,
      "mae_dx": 0.013419872149825096,
      "mae_dy": 0.0071934908628463745,
      "pose_mae_dtheta": 0.2782227396965027,
      "pose_mae_dx": 0.11688869446516037,
      "pose_mae_dy": 0.08709966391324997,
      "pose_rmse_dtheta": 0.44619032740592957,
      "pose_rmse_dx": 0.23768365383148193,
      "pose_rmse_dy": 0.19185155630111694,
      "pose_rmse_mean": 0.29190853238105774,
      "rmse_dtheta": 0.05013822391629219,
      "rmse_dx": 0.02550651691854,
      "rmse_dy": 0.014040767215192318,
      "rmse_mean": 0.029895169660449028,
      "rotation_flip": 0.016420360654592514,
      "sparse_tokens": 20474.0,
      "step": 2922,
      "turn_loss": 0.30758947134017944,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.13580189555844638,
      "grad_norm": 0.8096222281455994,
      "learning_rate": 8.68906535860033e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.010193904861807823,
      "mae_dx": 0.002102428814396262,
      "mae_dy": 0.0019632403273135424,
      "pose_mae_dtheta": 0.07221299409866333,
      "pose_mae_dx": 0.0237843357026577,
      "pose_mae_dy": 0.031035611405968666,
      "pose_rmse_dtheta": 0.1566118746995926,
      "pose_rmse_dx": 0.06015828624367714,
      "pose_rmse_dy": 0.07934511452913284,
      "pose_rmse_mean": 0.09870509803295135,
      "rmse_dtheta": 0.02144256792962551,
      "rmse_dx": 0.00617110775783658,
      "rmse_dy": 0.004960435908287764,
      "rmse_mean": 0.010858036577701569,
      "rotation_flip": 0.005296099931001663,
      "sparse_tokens": 32121.0,
      "step": 2923,
      "turn_loss": 0.08490460366010666,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29431.0,
      "epoch": 0.13584835532428916,
      "grad_norm": 0.6883128881454468,
      "learning_rate": 8.688172724978845e-06,
      "loss": 0.1737,
      "mae_dtheta": 0.03956777974963188,
      "mae_dx": 0.013598751276731491,
      "mae_dy": 0.00414865929633379,
      "pose_mae_dtheta": 0.32463935017585754,
      "pose_mae_dx": 0.11222019791603088,
      "pose_mae_dy": 0.049909044057130814,
      "pose_rmse_dtheta": 0.55421382188797,
      "pose_rmse_dx": 0.23252640664577484,
      "pose_rmse_dy": 0.11819903552532196,
      "pose_rmse_mean": 0.3016464412212372,
      "rmse_dtheta": 0.058179210871458054,
      "rmse_dx": 0.025981280952692032,
      "rmse_dy": 0.009344859048724174,
      "rmse_mean": 0.03116845153272152,
      "rotation_flip": 0.020053476095199585,
      "sparse_tokens": 24685.0,
      "step": 2924,
      "turn_loss": 0.29802843928337097,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.13589481509013196,
      "grad_norm": 1.0274242162704468,
      "learning_rate": 8.687279833441462e-06,
      "loss": 0.1,
      "mae_dtheta": 0.010445650666952133,
      "mae_dx": 0.002646486507728696,
      "mae_dy": 0.00027843768475577235,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999991655349731,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 154.4382781982422,
      "model/head/act_norm_mean": 127.3921539614899,
      "model/head/act_norm_min": 71.777587890625,
      "model/head/act_over_embed": 87.54508086647198,
      "model/head/grad_frac": 0.07705492526292801,
      "model/head/grad_norm": 0.07705485820770264,
      "model/head/grad_zero_frac": 0.00013737867993768305,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6780105744949495,
      "model/head/update_ratio": 0.0013303282903507352,
      "model/head/weight_delta": 6.316467761993408,
      "model/head/weight_delta_rel": 0.1108095571398735,
      "model/head/weight_norm": 57.921688079833984,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41618677973747253,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4160970993983893,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4160287380218506,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2859458222689933,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11888580769300461,
      "model/modality_embedder.encoders.pose/grad_norm": 0.11888571083545685,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5435394161522634,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0038580105174332857,
      "model/modality_embedder.encoders.pose/weight_delta": 2.0703067779541016,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06764337420463562,
      "model/modality_embedder.encoders.pose/weight_norm": 30.815288543701172,
      "model/modality_embedder/grad_frac": 0.11888580769300461,
      "model/modality_embedder/grad_norm": 0.11888571083545685,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5435394161522634,
      "model/modality_embedder/update_ratio": 0.0038580105174332857,
      "model/modality_embedder/weight_delta": 2.0703067779541016,
      "model/modality_embedder/weight_delta_rel": 0.06764337420463562,
      "model/modality_embedder/weight_norm": 30.815288543701172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.51172637939453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.253554894179896,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.095174789428711,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.35447935078632,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.062398046255111694,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.062397994101047516,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002254665130749345,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.3754709959030151,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05012299492955208,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.675060272216797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.33574676513672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.39771725188392,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.456634521484375,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.140758434817286,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05738598853349686,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05738594010472298,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001959363929927349,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.7283885478973389,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.05987273156642914,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.28804588317871,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.34356689453125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.282605319063652,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.342340469360352,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.43607116118331,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05946844071149826,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05946839228272438,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 9.0784378699027e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019671667832881212,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.851056694984436,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.062155019491910934,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.230478286743164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.24749755859375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 30.03044332210999,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.307971000671387,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.637201800393946,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07400230318307877,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07400224357843399,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0025015517603605986,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.5792207717895508,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05397026985883713,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.582534790039062,
      "model/normalizer/grad_frac": 0.2698450982570648,
      "model/normalizer/grad_norm": 0.2698448598384857,
      "model/normalizer/grad_zero_frac": 0.00011344689119141549,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003454397665336728,
      "model/normalizer/weight_delta": 3.3643438816070557,
      "model/normalizer/weight_delta_rel": 0.04333079978823662,
      "model/normalizer/weight_norm": 78.11632537841797,
      "pose_mae_dtheta": 0.07361532747745514,
      "pose_mae_dx": 0.021630417555570602,
      "pose_mae_dy": 0.0038165547885000706,
      "pose_rmse_dtheta": 0.2761007845401764,
      "pose_rmse_dx": 0.04835403338074684,
      "pose_rmse_dy": 0.009205078706145287,
      "pose_rmse_mean": 0.11121996492147446,
      "rmse_dtheta": 0.033321771770715714,
      "rmse_dx": 0.007070603780448437,
      "rmse_dy": 0.0004664014559239149,
      "rmse_mean": 0.013619593344628811,
      "rotation_flip": 0.000518403307069093,
      "sparse_tokens": 32265.0,
      "step": 2925,
      "turn_loss": 0.060557279735803604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34282.0,
      "epoch": 0.13594127485597474,
      "grad_norm": 0.5947932600975037,
      "learning_rate": 8.68638668405062e-06,
      "loss": 0.1892,
      "mae_dtheta": 0.027644313871860504,
      "mae_dx": 0.014136378653347492,
      "mae_dy": 0.00355535582639277,
      "pose_mae_dtheta": 0.21467722952365875,
      "pose_mae_dx": 0.11206556111574173,
      "pose_mae_dy": 0.04495970532298088,
      "pose_rmse_dtheta": 0.39344605803489685,
      "pose_rmse_dx": 0.2617078721523285,
      "pose_rmse_dy": 0.1121918112039566,
      "pose_rmse_mean": 0.2557819187641144,
      "rmse_dtheta": 0.04397256299853325,
      "rmse_dx": 0.02768165059387684,
      "rmse_dy": 0.007866360247135162,
      "rmse_mean": 0.026506859809160233,
      "rotation_flip": 0.01044568233191967,
      "sparse_tokens": 25793.0,
      "step": 2926,
      "turn_loss": 0.2274460345506668,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 24338.0,
      "epoch": 0.1359877346218175,
      "grad_norm": 0.6765921711921692,
      "learning_rate": 8.685493276868781e-06,
      "loss": 0.1598,
      "mae_dtheta": 0.03853919729590416,
      "mae_dx": 0.011237269267439842,
      "mae_dy": 0.003620642004534602,
      "pose_mae_dtheta": 0.2863691747188568,
      "pose_mae_dx": 0.09093336760997772,
      "pose_mae_dy": 0.034387826919555664,
      "pose_rmse_dtheta": 0.4936507046222687,
      "pose_rmse_dx": 0.18067535758018494,
      "pose_rmse_dy": 0.08084199577569962,
      "pose_rmse_mean": 0.25172269344329834,
      "rmse_dtheta": 0.057436972856521606,
      "rmse_dx": 0.021835118532180786,
      "rmse_dy": 0.008344326168298721,
      "rmse_mean": 0.02920547127723694,
      "rotation_flip": 0.014705882407724857,
      "sparse_tokens": 19962.0,
      "step": 2927,
      "turn_loss": 0.26728469133377075,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.1360341943876603,
      "grad_norm": 0.5999640822410583,
      "learning_rate": 8.684599611958418e-06,
      "loss": 0.1927,
      "mae_dtheta": 0.028553973883390427,
      "mae_dx": 0.010431981645524502,
      "mae_dy": 0.004187790211290121,
      "pose_mae_dtheta": 0.22353720664978027,
      "pose_mae_dx": 0.09669788926839828,
      "pose_mae_dy": 0.05443863943219185,
      "pose_rmse_dtheta": 0.40407395362854004,
      "pose_rmse_dx": 0.2268533855676651,
      "pose_rmse_dy": 0.12413029372692108,
      "pose_rmse_mean": 0.25168588757514954,
      "rmse_dtheta": 0.04542487859725952,
      "rmse_dx": 0.02296624332666397,
      "rmse_dy": 0.00892194826155901,
      "rmse_mean": 0.02577102556824684,
      "rotation_flip": 0.02078137919306755,
      "sparse_tokens": 21458.0,
      "step": 2928,
      "turn_loss": 0.25831499695777893,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.13608065415350307,
      "grad_norm": 0.6142131090164185,
      "learning_rate": 8.683705689382025e-06,
      "loss": 0.1354,
      "mae_dtheta": 0.009379108436405659,
      "mae_dx": 0.002037729136645794,
      "mae_dy": 0.0017446113051846623,
      "pose_mae_dtheta": 0.06376107782125473,
      "pose_mae_dx": 0.021290913224220276,
      "pose_mae_dy": 0.02808780036866665,
      "pose_rmse_dtheta": 0.13734368979930878,
      "pose_rmse_dx": 0.05692354962229729,
      "pose_rmse_dy": 0.07436311990022659,
      "pose_rmse_mean": 0.08954345434904099,
      "rmse_dtheta": 0.019660145044326782,
      "rmse_dx": 0.0063310908153653145,
      "rmse_dy": 0.003768078749999404,
      "rmse_mean": 0.009919771924614906,
      "rotation_flip": 0.00538423890247941,
      "sparse_tokens": 32121.0,
      "step": 2929,
      "turn_loss": 0.07462310791015625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.13612711391934584,
      "grad_norm": 0.5383339524269104,
      "learning_rate": 8.682811509202118e-06,
      "loss": 0.1325,
      "mae_dtheta": 0.013505768030881882,
      "mae_dx": 0.00264038797467947,
      "mae_dy": 0.0029923294205218554,
      "pose_mae_dtheta": 0.09916906803846359,
      "pose_mae_dx": 0.03236028552055359,
      "pose_mae_dy": 0.03652171045541763,
      "pose_rmse_dtheta": 0.2416260689496994,
      "pose_rmse_dx": 0.0761052593588829,
      "pose_rmse_dy": 0.07789712399244308,
      "pose_rmse_mean": 0.1318761557340622,
      "rmse_dtheta": 0.027645854279398918,
      "rmse_dx": 0.007564890664070845,
      "rmse_dy": 0.006208179052919149,
      "rmse_mean": 0.013806307688355446,
      "rotation_flip": 0.005643738899379969,
      "sparse_tokens": 32073.0,
      "step": 2930,
      "turn_loss": 0.08866375684738159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.13617357368518862,
      "grad_norm": 0.6590913534164429,
      "learning_rate": 8.681917071481224e-06,
      "loss": 0.148,
      "mae_dtheta": 0.033619895577430725,
      "mae_dx": 0.00734799075871706,
      "mae_dy": 0.004230660852044821,
      "pose_mae_dtheta": 0.24470022320747375,
      "pose_mae_dx": 0.04587220400571823,
      "pose_mae_dy": 0.05558545142412186,
      "pose_rmse_dtheta": 0.43603020906448364,
      "pose_rmse_dx": 0.1395399421453476,
      "pose_rmse_dy": 0.1274026781320572,
      "pose_rmse_mean": 0.23432427644729614,
      "rmse_dtheta": 0.05324112996459007,
      "rmse_dx": 0.018569068983197212,
      "rmse_dy": 0.008197875693440437,
      "rmse_mean": 0.02666935883462429,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 6803.0,
      "step": 2931,
      "turn_loss": 0.26016902923583984,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.1362200334510314,
      "grad_norm": 0.5067033171653748,
      "learning_rate": 8.681022376281894e-06,
      "loss": 0.1064,
      "mae_dtheta": 0.03459348529577255,
      "mae_dx": 0.01407184824347496,
      "mae_dy": 0.005852506961673498,
      "pose_mae_dtheta": 0.23619437217712402,
      "pose_mae_dx": 0.10108000785112381,
      "pose_mae_dy": 0.06681707501411438,
      "pose_rmse_dtheta": 0.3891582787036896,
      "pose_rmse_dx": 0.22562286257743835,
      "pose_rmse_dy": 0.14059250056743622,
      "pose_rmse_mean": 0.25179123878479004,
      "rmse_dtheta": 0.049616094678640366,
      "rmse_dx": 0.026887116953730583,
      "rmse_dy": 0.010965473018586636,
      "rmse_mean": 0.02915622852742672,
      "rotation_flip": 0.0173611119389534,
      "sparse_tokens": 10651.0,
      "step": 2932,
      "turn_loss": 0.2659810185432434,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.13626649321687417,
      "grad_norm": 0.5120511651039124,
      "learning_rate": 8.680127423666694e-06,
      "loss": 0.1244,
      "mae_dtheta": 0.015329242683947086,
      "mae_dx": 0.0036661988124251366,
      "mae_dy": 0.005506687797605991,
      "pose_mae_dtheta": 0.10522070527076721,
      "pose_mae_dx": 0.05623885244131088,
      "pose_mae_dy": 0.050364527851343155,
      "pose_rmse_dtheta": 0.23387852311134338,
      "pose_rmse_dx": 0.13813559710979462,
      "pose_rmse_dy": 0.10885720700025558,
      "pose_rmse_mean": 0.1602904498577118,
      "rmse_dtheta": 0.028975700959563255,
      "rmse_dx": 0.008674894459545612,
      "rmse_dy": 0.011140854097902775,
      "rmse_mean": 0.016263816505670547,
      "rotation_flip": 0.007526177912950516,
      "sparse_tokens": 32121.0,
      "step": 2933,
      "turn_loss": 0.15140767395496368,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.13631295298271698,
      "grad_norm": 0.4757317900657654,
      "learning_rate": 8.679232213698206e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.013246430084109306,
      "mae_dx": 0.002415313618257642,
      "mae_dy": 0.003848079824820161,
      "pose_mae_dtheta": 0.0904892086982727,
      "pose_mae_dx": 0.03457456827163696,
      "pose_mae_dy": 0.03488726168870926,
      "pose_rmse_dtheta": 0.2142225056886673,
      "pose_rmse_dx": 0.08748997002840042,
      "pose_rmse_dy": 0.07834435254335403,
      "pose_rmse_mean": 0.12668561935424805,
      "rmse_dtheta": 0.02607528120279312,
      "rmse_dx": 0.006071033421903849,
      "rmse_dy": 0.008039690554141998,
      "rmse_mean": 0.013395335525274277,
      "rotation_flip": 0.012259194627404213,
      "sparse_tokens": 32105.0,
      "step": 2934,
      "turn_loss": 0.12321305274963379,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11705.0,
      "epoch": 0.13635941274855976,
      "grad_norm": 0.481689453125,
      "learning_rate": 8.678336746439036e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.042933762073516846,
      "mae_dx": 0.012642806395888329,
      "mae_dy": 0.006262714974582195,
      "pose_mae_dtheta": 0.3361591398715973,
      "pose_mae_dx": 0.09064751863479614,
      "pose_mae_dy": 0.05930047109723091,
      "pose_rmse_dtheta": 0.5366530418395996,
      "pose_rmse_dx": 0.18084760010242462,
      "pose_rmse_dy": 0.14177703857421875,
      "pose_rmse_mean": 0.2864258885383606,
      "rmse_dtheta": 0.06034881994128227,
      "rmse_dx": 0.023972120136022568,
      "rmse_dy": 0.012655829079449177,
      "rmse_mean": 0.03232559189200401,
      "rotation_flip": 0.012500000186264515,
      "sparse_tokens": 9713.0,
      "step": 2935,
      "turn_loss": 0.3504686951637268,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.13640587251440253,
      "grad_norm": 1.4239404201507568,
      "learning_rate": 8.677441021951802e-06,
      "loss": 0.2989,
      "mae_dtheta": 0.04120466113090515,
      "mae_dx": 0.01537282019853592,
      "mae_dy": 0.005340212490409613,
      "pose_mae_dtheta": 0.33409228920936584,
      "pose_mae_dx": 0.13560311496257782,
      "pose_mae_dy": 0.07285990566015244,
      "pose_rmse_dtheta": 0.5800790786743164,
      "pose_rmse_dx": 0.28625473380088806,
      "pose_rmse_dy": 0.14960992336273193,
      "pose_rmse_mean": 0.3386479318141937,
      "rmse_dtheta": 0.05924303084611893,
      "rmse_dx": 0.02931579388678074,
      "rmse_dy": 0.009197771549224854,
      "rmse_mean": 0.03258553147315979,
      "rotation_flip": 0.010285714641213417,
      "sparse_tokens": 14320.0,
      "step": 2936,
      "turn_loss": 0.32908275723457336,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1364523322802453,
      "grad_norm": 0.9213584065437317,
      "learning_rate": 8.676545040299145e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.012523542158305645,
      "mae_dx": 0.0021873649675399065,
      "mae_dy": 0.002231874503195286,
      "pose_mae_dtheta": 0.08702319115400314,
      "pose_mae_dx": 0.026681728661060333,
      "pose_mae_dy": 0.029819278046488762,
      "pose_rmse_dtheta": 0.21895024180412292,
      "pose_rmse_dx": 0.060803160071372986,
      "pose_rmse_dy": 0.06475963443517685,
      "pose_rmse_mean": 0.11483767628669739,
      "rmse_dtheta": 0.026104005053639412,
      "rmse_dx": 0.006510471925139427,
      "rmse_dy": 0.004435096401721239,
      "rmse_mean": 0.012349857948720455,
      "rotation_flip": 0.0028612304013222456,
      "sparse_tokens": 32105.0,
      "step": 2937,
      "turn_loss": 0.11240594834089279,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.13649879204608809,
      "grad_norm": 0.7714553475379944,
      "learning_rate": 8.675648801543717e-06,
      "loss": 0.1379,
      "mae_dtheta": 0.03912285342812538,
      "mae_dx": 0.013455522246658802,
      "mae_dy": 0.005530972499400377,
      "pose_mae_dtheta": 0.32376569509506226,
      "pose_mae_dx": 0.11741015315055847,
      "pose_mae_dy": 0.08193980157375336,
      "pose_rmse_dtheta": 0.5198453068733215,
      "pose_rmse_dx": 0.2505466938018799,
      "pose_rmse_dy": 0.19124284386634827,
      "pose_rmse_mean": 0.320544958114624,
      "rmse_dtheta": 0.056328702718019485,
      "rmse_dx": 0.026284677907824516,
      "rmse_dy": 0.010851765051484108,
      "rmse_mean": 0.031155047938227654,
      "rotation_flip": 0.0059523810632526875,
      "sparse_tokens": 5911.0,
      "step": 2938,
      "turn_loss": 0.3470541536808014,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.13654525181193086,
      "grad_norm": 0.5702707171440125,
      "learning_rate": 8.6747523057482e-06,
      "loss": 0.1594,
      "mae_dtheta": 0.011650142259895802,
      "mae_dx": 0.0019013488199561834,
      "mae_dy": 0.002427671803161502,
      "pose_mae_dtheta": 0.08280055224895477,
      "pose_mae_dx": 0.022969583049416542,
      "pose_mae_dy": 0.02896500937640667,
      "pose_rmse_dtheta": 0.2091088443994522,
      "pose_rmse_dx": 0.05306408926844597,
      "pose_rmse_dy": 0.07197775691747665,
      "pose_rmse_mean": 0.11138357222080231,
      "rmse_dtheta": 0.02476987987756729,
      "rmse_dx": 0.0050681778229773045,
      "rmse_dy": 0.004929804243147373,
      "rmse_mean": 0.011589287780225277,
      "rotation_flip": 0.00592128187417984,
      "sparse_tokens": 32137.0,
      "step": 2939,
      "turn_loss": 0.09209852665662766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.13659171157777364,
      "grad_norm": 1.0709666013717651,
      "learning_rate": 8.673855552975279e-06,
      "loss": 0.3225,
      "mae_dtheta": 0.021202748641371727,
      "mae_dx": 0.007965156808495522,
      "mae_dy": 0.002356459852308035,
      "pose_mae_dtheta": 0.15973995625972748,
      "pose_mae_dx": 0.07041269540786743,
      "pose_mae_dy": 0.03170747682452202,
      "pose_rmse_dtheta": 0.3788365125656128,
      "pose_rmse_dx": 0.17828679084777832,
      "pose_rmse_dy": 0.06599490344524384,
      "pose_rmse_mean": 0.20770607888698578,
      "rmse_dtheta": 0.04203629121184349,
      "rmse_dx": 0.019178584218025208,
      "rmse_dy": 0.0047367168590426445,
      "rmse_mean": 0.021983865648508072,
      "rotation_flip": 0.006896551698446274,
      "sparse_tokens": 6328.0,
      "step": 2940,
      "turn_loss": 0.1706649661064148,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 16563.0,
      "epoch": 0.13663817134361642,
      "grad_norm": 0.6448651552200317,
      "learning_rate": 8.672958543287666e-06,
      "loss": 0.1656,
      "mae_dtheta": 0.030321212485432625,
      "mae_dx": 0.007637782953679562,
      "mae_dy": 0.006823158822953701,
      "pose_mae_dtheta": 0.23511339724063873,
      "pose_mae_dx": 0.0651606023311615,
      "pose_mae_dy": 0.07302815467119217,
      "pose_rmse_dtheta": 0.4110832214355469,
      "pose_rmse_dx": 0.1597607582807541,
      "pose_rmse_dy": 0.15310414135456085,
      "pose_rmse_mean": 0.2413160502910614,
      "rmse_dtheta": 0.04663076251745224,
      "rmse_dx": 0.01812068000435829,
      "rmse_dy": 0.011878020130097866,
      "rmse_mean": 0.025543157011270523,
      "rotation_flip": 0.0058823530562222,
      "sparse_tokens": 13647.0,
      "step": 2941,
      "turn_loss": 0.27269378304481506,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.13668463110945922,
      "grad_norm": 0.46292150020599365,
      "learning_rate": 8.672061276748094e-06,
      "loss": 0.0901,
      "mae_dtheta": 0.008657547645270824,
      "mae_dx": 0.001693379832431674,
      "mae_dy": 0.0015292997704818845,
      "pose_mae_dtheta": 0.05564846098423004,
      "pose_mae_dx": 0.02028539776802063,
      "pose_mae_dy": 0.019976474344730377,
      "pose_rmse_dtheta": 0.1361306756734848,
      "pose_rmse_dx": 0.051679473370313644,
      "pose_rmse_dy": 0.05061887204647064,
      "pose_rmse_mean": 0.07947634160518646,
      "rmse_dtheta": 0.020093178376555443,
      "rmse_dx": 0.004952886141836643,
      "rmse_dy": 0.003435205202549696,
      "rmse_mean": 0.009493757039308548,
      "rotation_flip": 0.002383790211752057,
      "sparse_tokens": 32153.0,
      "step": 2942,
      "turn_loss": 0.06981202214956284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.136731090875302,
      "grad_norm": 0.5805003643035889,
      "learning_rate": 8.671163753419304e-06,
      "loss": 0.1616,
      "mae_dtheta": 0.014586059376597404,
      "mae_dx": 0.00487107178196311,
      "mae_dy": 0.0032374723814427853,
      "pose_mae_dtheta": 0.09535715728998184,
      "pose_mae_dx": 0.04646496847271919,
      "pose_mae_dy": 0.04508485272526741,
      "pose_rmse_dtheta": 0.18300345540046692,
      "pose_rmse_dx": 0.13314160704612732,
      "pose_rmse_dy": 0.10600145906209946,
      "pose_rmse_mean": 0.14071550965309143,
      "rmse_dtheta": 0.026482736691832542,
      "rmse_dx": 0.014382692985236645,
      "rmse_dy": 0.006705212872475386,
      "rmse_mean": 0.015856880694627762,
      "rotation_flip": 0.00586907472461462,
      "sparse_tokens": 32041.0,
      "step": 2943,
      "turn_loss": 0.17359724640846252,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.13677755064114477,
      "grad_norm": 0.6458073258399963,
      "learning_rate": 8.670265973364062e-06,
      "loss": 0.1968,
      "mae_dtheta": 0.03484880551695824,
      "mae_dx": 0.009103339165449142,
      "mae_dy": 0.005601081065833569,
      "pose_mae_dtheta": 0.2540256679058075,
      "pose_mae_dx": 0.06751222908496857,
      "pose_mae_dy": 0.03952990472316742,
      "pose_rmse_dtheta": 0.4560866355895996,
      "pose_rmse_dx": 0.1459677815437317,
      "pose_rmse_dy": 0.08282341808080673,
      "pose_rmse_mean": 0.22829261422157288,
      "rmse_dtheta": 0.054036665707826614,
      "rmse_dx": 0.019279900938272476,
      "rmse_dy": 0.012264899909496307,
      "rmse_mean": 0.0285271555185318,
      "rotation_flip": 0.01756756752729416,
      "sparse_tokens": 12052.0,
      "step": 2944,
      "turn_loss": 0.26279109716415405,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 18129.0,
      "epoch": 0.13682401040698755,
      "grad_norm": 0.8041396141052246,
      "learning_rate": 8.669367936645152e-06,
      "loss": 0.1871,
      "mae_dtheta": 0.0430125892162323,
      "mae_dx": 0.010439667850732803,
      "mae_dy": 0.004621137864887714,
      "pose_mae_dtheta": 0.3578735589981079,
      "pose_mae_dx": 0.0848870724439621,
      "pose_mae_dy": 0.05195090174674988,
      "pose_rmse_dtheta": 0.6449967622756958,
      "pose_rmse_dx": 0.1886337846517563,
      "pose_rmse_dy": 0.16578912734985352,
      "pose_rmse_mean": 0.33313989639282227,
      "rmse_dtheta": 0.06448116153478622,
      "rmse_dx": 0.02112947776913643,
      "rmse_dy": 0.011804196983575821,
      "rmse_mean": 0.032471612095832825,
      "rotation_flip": 0.01193317398428917,
      "sparse_tokens": 14145.0,
      "step": 2945,
      "turn_loss": 0.2945999503135681,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 19421.0,
      "epoch": 0.13687047017283033,
      "grad_norm": 0.43152424693107605,
      "learning_rate": 8.668469643325373e-06,
      "loss": 0.129,
      "mae_dtheta": 0.028423026204109192,
      "mae_dx": 0.009781022556126118,
      "mae_dy": 0.0029689886141568422,
      "pose_mae_dtheta": 0.23824362456798553,
      "pose_mae_dx": 0.08797579258680344,
      "pose_mae_dy": 0.054778411984443665,
      "pose_rmse_dtheta": 0.42254453897476196,
      "pose_rmse_dx": 0.21528539061546326,
      "pose_rmse_dy": 0.11136913299560547,
      "pose_rmse_mean": 0.24973301589488983,
      "rmse_dtheta": 0.045284025371074677,
      "rmse_dx": 0.0227454025298357,
      "rmse_dy": 0.0052201468497514725,
      "rmse_mean": 0.024416524916887283,
      "rotation_flip": 0.01112484559416771,
      "sparse_tokens": 15856.0,
      "step": 2946,
      "turn_loss": 0.17200782895088196,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.1369169299386731,
      "grad_norm": 0.8086241483688354,
      "learning_rate": 8.667571093467542e-06,
      "loss": 0.2894,
      "mae_dtheta": 0.0317821279168129,
      "mae_dx": 0.015603188425302505,
      "mae_dy": 0.008251449093222618,
      "pose_mae_dtheta": 0.2661697268486023,
      "pose_mae_dx": 0.14047333598136902,
      "pose_mae_dy": 0.10992367565631866,
      "pose_rmse_dtheta": 0.43005356192588806,
      "pose_rmse_dx": 0.2834422290325165,
      "pose_rmse_dy": 0.24812005460262299,
      "pose_rmse_mean": 0.32053864002227783,
      "rmse_dtheta": 0.04656011611223221,
      "rmse_dx": 0.029004771262407303,
      "rmse_dy": 0.017844073474407196,
      "rmse_mean": 0.031136322766542435,
      "rotation_flip": 0.02237762324512005,
      "sparse_tokens": 13345.0,
      "step": 2947,
      "turn_loss": 0.2865830957889557,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.13696338970451588,
      "grad_norm": 0.49909234046936035,
      "learning_rate": 8.666672287134494e-06,
      "loss": 0.114,
      "mae_dtheta": 0.01095981802791357,
      "mae_dx": 0.0018681035144254565,
      "mae_dy": 0.0015934384427964687,
      "pose_mae_dtheta": 0.07562962919473648,
      "pose_mae_dx": 0.02094326913356781,
      "pose_mae_dy": 0.020794052630662918,
      "pose_rmse_dtheta": 0.2085145264863968,
      "pose_rmse_dx": 0.05788043141365051,
      "pose_rmse_dy": 0.052930571138858795,
      "pose_rmse_mean": 0.10644184798002243,
      "rmse_dtheta": 0.026109110563993454,
      "rmse_dx": 0.006067921407520771,
      "rmse_dy": 0.003790040733292699,
      "rmse_mean": 0.01198902353644371,
      "rotation_flip": 0.0029910269659012556,
      "sparse_tokens": 32105.0,
      "step": 2948,
      "turn_loss": 0.07554370909929276,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.13700984947035866,
      "grad_norm": 0.40791547298431396,
      "learning_rate": 8.665773224389088e-06,
      "loss": 0.0934,
      "mae_dtheta": 0.03071487508714199,
      "mae_dx": 0.011905038729310036,
      "mae_dy": 0.006349319592118263,
      "pose_mae_dtheta": 0.22155047953128815,
      "pose_mae_dx": 0.10048805922269821,
      "pose_mae_dy": 0.0665208101272583,
      "pose_rmse_dtheta": 0.39842820167541504,
      "pose_rmse_dx": 0.21743561327457428,
      "pose_rmse_dy": 0.16867323219776154,
      "pose_rmse_mean": 0.2615123391151428,
      "rmse_dtheta": 0.04825197905302048,
      "rmse_dx": 0.023593295365571976,
      "rmse_dy": 0.014579785987734795,
      "rmse_mean": 0.0288083553314209,
      "rotation_flip": 0.009661835618317127,
      "sparse_tokens": 17829.0,
      "step": 2949,
      "turn_loss": 0.28254279494285583,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.13705630923620146,
      "grad_norm": 0.5236440896987915,
      "learning_rate": 8.664873905294191e-06,
      "loss": 0.131,
      "mae_dtheta": 0.03505120798945427,
      "mae_dx": 0.01054334081709385,
      "mae_dy": 0.0045869736932218075,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5236440896987915,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.89996337890625,
      "model/head/act_norm_mean": 105.84651442307693,
      "model/head/act_norm_min": 67.66600799560547,
      "model/head/act_over_embed": 72.73871566221918,
      "model/head/grad_frac": 0.08998474478721619,
      "model/head/grad_norm": 0.047119978815317154,
      "model/head/grad_zero_frac": 0.0001884594385046512,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6789362980769231,
      "model/head/update_ratio": 0.0008134011877700686,
      "model/head/weight_delta": 6.35064697265625,
      "model/head/weight_delta_rel": 0.11140915751457214,
      "model/head/weight_norm": 57.929569244384766,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41607943177223206,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41601227269028174,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4159502387046814,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2858875285610216,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0781470388174057,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04092123359441757,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5478515625,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013278888072818518,
      "model/modality_embedder.encoders.pose/weight_delta": 2.0770089626312256,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06786235421895981,
      "model/modality_embedder.encoders.pose/weight_norm": 30.816762924194336,
      "model/modality_embedder/grad_frac": 0.0781470388174057,
      "model/modality_embedder/grad_norm": 0.04092123359441757,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5478515625,
      "model/modality_embedder/update_ratio": 0.0013278888072818518,
      "model/modality_embedder/weight_delta": 2.0770089626312256,
      "model/modality_embedder/weight_delta_rel": 0.06786235421895981,
      "model/modality_embedder/weight_norm": 30.816762924194336,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.94071960449219,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.134178495115997,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.114079475402832,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.898024047435145,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09434705227613449,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04940427467226982,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017850656295195222,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.3847153186798096,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.050459861755371094,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.67644691467285,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.82635498046875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.01338141025641,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.826310157775879,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.502220521947017,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09222611784934998,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04829366132616997,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016487854300066829,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.7402859926223755,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06028486788272858,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.290447235107422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.75969696044922,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.685994734432235,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.987984657287598,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.651656057573298,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09992484003305435,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0523250512778759,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017306653317064047,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.8644976615905762,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0626063421368599,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.234066009521484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 82.65241241455078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.63237561050061,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.898177146911621,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.989227217912344,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12219144403934479,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06398482620716095,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0021627165842801332,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.5913503170013428,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05438480153679848,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.58539581298828,
      "model/normalizer/grad_frac": 0.503699779510498,
      "model/normalizer/grad_norm": 0.26375940442085266,
      "model/normalizer/grad_zero_frac": 0.00015835295198485255,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003376347478479147,
      "model/normalizer/weight_delta": 3.3884389400482178,
      "model/normalizer/weight_delta_rel": 0.04364113137125969,
      "model/normalizer/weight_norm": 78.11974334716797,
      "pose_mae_dtheta": 0.26826509833335876,
      "pose_mae_dx": 0.08699420094490051,
      "pose_mae_dy": 0.04351712018251419,
      "pose_rmse_dtheta": 0.4735424816608429,
      "pose_rmse_dx": 0.19223396480083466,
      "pose_rmse_dy": 0.1042097732424736,
      "pose_rmse_mean": 0.2566620707511902,
      "rmse_dtheta": 0.054863739758729935,
      "rmse_dx": 0.021390041336417198,
      "rmse_dy": 0.011464818380773067,
      "rmse_mean": 0.029239533469080925,
      "rotation_flip": 0.01274509821087122,
      "sparse_tokens": 16147.0,
      "step": 2950,
      "turn_loss": 0.29003190994262695,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 15917.0,
      "epoch": 0.13710276900204424,
      "grad_norm": 0.49366259574890137,
      "learning_rate": 8.663974329912695e-06,
      "loss": 0.0912,
      "mae_dtheta": 0.03398250415921211,
      "mae_dx": 0.008950987830758095,
      "mae_dy": 0.004286010749638081,
      "pose_mae_dtheta": 0.26142600178718567,
      "pose_mae_dx": 0.06705144047737122,
      "pose_mae_dy": 0.045193225145339966,
      "pose_rmse_dtheta": 0.4584959149360657,
      "pose_rmse_dx": 0.15962035953998566,
      "pose_rmse_dy": 0.10260116308927536,
      "pose_rmse_mean": 0.24023914337158203,
      "rmse_dtheta": 0.05339912325143814,
      "rmse_dx": 0.019504718482494354,
      "rmse_dy": 0.008470715954899788,
      "rmse_mean": 0.027124851942062378,
      "rotation_flip": 0.009055627509951591,
      "sparse_tokens": 13492.0,
      "step": 2951,
      "turn_loss": 0.2644198536872864,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13714922876788702,
      "grad_norm": 0.6447760462760925,
      "learning_rate": 8.663074498307508e-06,
      "loss": 0.1529,
      "mae_dtheta": 0.00916408933699131,
      "mae_dx": 0.001848001265898347,
      "mae_dy": 0.0022239135578274727,
      "pose_mae_dtheta": 0.06771710515022278,
      "pose_mae_dx": 0.026123324409127235,
      "pose_mae_dy": 0.027118850499391556,
      "pose_rmse_dtheta": 0.20339252054691315,
      "pose_rmse_dx": 0.06956417858600616,
      "pose_rmse_dy": 0.06827805191278458,
      "pose_rmse_mean": 0.11374491453170776,
      "rmse_dtheta": 0.022592123597860336,
      "rmse_dx": 0.005603767465800047,
      "rmse_dy": 0.0051497723907232285,
      "rmse_mean": 0.011115221306681633,
      "rotation_flip": 0.0004524886899162084,
      "sparse_tokens": 32089.0,
      "step": 2952,
      "turn_loss": 0.07694410532712936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1371956885337298,
      "grad_norm": 0.3824109435081482,
      "learning_rate": 8.662174410541556e-06,
      "loss": 0.0953,
      "mae_dtheta": 0.010853435844182968,
      "mae_dx": 0.001866691978648305,
      "mae_dy": 0.0012125722132623196,
      "pose_mae_dtheta": 0.08013910800218582,
      "pose_mae_dx": 0.01858462393283844,
      "pose_mae_dy": 0.016834678128361702,
      "pose_rmse_dtheta": 0.2668459713459015,
      "pose_rmse_dx": 0.05038038268685341,
      "pose_rmse_dy": 0.03653119504451752,
      "pose_rmse_mean": 0.1179191917181015,
      "rmse_dtheta": 0.02968977950513363,
      "rmse_dx": 0.006052935030311346,
      "rmse_dy": 0.002603011904284358,
      "rmse_mean": 0.012781909666955471,
      "rotation_flip": 0.004407227970659733,
      "sparse_tokens": 32169.0,
      "step": 2953,
      "turn_loss": 0.06523275375366211,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.13724214829957257,
      "grad_norm": 0.5219913721084595,
      "learning_rate": 8.66127406667778e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.030518991872668266,
      "mae_dx": 0.013560561463236809,
      "mae_dy": 0.0038858414627611637,
      "pose_mae_dtheta": 0.24140091240406036,
      "pose_mae_dx": 0.12171381711959839,
      "pose_mae_dy": 0.04381561651825905,
      "pose_rmse_dtheta": 0.4421564042568207,
      "pose_rmse_dx": 0.24153685569763184,
      "pose_rmse_dy": 0.09886913746595383,
      "pose_rmse_mean": 0.26085415482521057,
      "rmse_dtheta": 0.04731343314051628,
      "rmse_dx": 0.025090588256716728,
      "rmse_dy": 0.0075713880360126495,
      "rmse_mean": 0.026658471673727036,
      "rotation_flip": 0.002463054144755006,
      "sparse_tokens": 7839.0,
      "step": 2954,
      "turn_loss": 0.20185664296150208,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.13728860806541535,
      "grad_norm": 0.4892176389694214,
      "learning_rate": 8.660373466779144e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.038160793483257294,
      "mae_dx": 0.014154225587844849,
      "mae_dy": 0.004563428461551666,
      "pose_mae_dtheta": 0.3204205632209778,
      "pose_mae_dx": 0.11178924143314362,
      "pose_mae_dy": 0.07241692394018173,
      "pose_rmse_dtheta": 0.5958239436149597,
      "pose_rmse_dx": 0.26722246408462524,
      "pose_rmse_dy": 0.17082755267620087,
      "pose_rmse_mean": 0.3446246385574341,
      "rmse_dtheta": 0.05880390480160713,
      "rmse_dx": 0.029080167412757874,
      "rmse_dy": 0.008000487461686134,
      "rmse_mean": 0.03196151927113533,
      "rotation_flip": 0.0138248847797513,
      "sparse_tokens": 7108.0,
      "step": 2955,
      "turn_loss": 0.2380022257566452,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 21424.0,
      "epoch": 0.13733506783125812,
      "grad_norm": 0.6279979348182678,
      "learning_rate": 8.659472610908628e-06,
      "loss": 0.1606,
      "mae_dtheta": 0.042288798838853836,
      "mae_dx": 0.012988011352717876,
      "mae_dy": 0.003783264197409153,
      "pose_mae_dtheta": 0.3320958614349365,
      "pose_mae_dx": 0.10175731033086777,
      "pose_mae_dy": 0.04039948806166649,
      "pose_rmse_dtheta": 0.5860289931297302,
      "pose_rmse_dx": 0.23235835134983063,
      "pose_rmse_dy": 0.10815923660993576,
      "pose_rmse_mean": 0.30884885787963867,
      "rmse_dtheta": 0.06291698664426804,
      "rmse_dx": 0.025541065260767937,
      "rmse_dy": 0.010065630078315735,
      "rmse_mean": 0.03284122794866562,
      "rotation_flip": 0.017351597547531128,
      "sparse_tokens": 17736.0,
      "step": 2956,
      "turn_loss": 0.25925543904304504,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.1373815275971009,
      "grad_norm": 0.8573633432388306,
      "learning_rate": 8.658571499129227e-06,
      "loss": 0.1792,
      "mae_dtheta": 0.037567541003227234,
      "mae_dx": 0.010347872041165829,
      "mae_dy": 0.008330774493515491,
      "pose_mae_dtheta": 0.28403306007385254,
      "pose_mae_dx": 0.08381202816963196,
      "pose_mae_dy": 0.08130575716495514,
      "pose_rmse_dtheta": 0.4998266398906708,
      "pose_rmse_dx": 0.1780475229024887,
      "pose_rmse_dy": 0.19521524012088776,
      "pose_rmse_mean": 0.29102981090545654,
      "rmse_dtheta": 0.05727050453424454,
      "rmse_dx": 0.020773055031895638,
      "rmse_dy": 0.018920773640275,
      "rmse_mean": 0.032321445643901825,
      "rotation_flip": 0.010676156729459763,
      "sparse_tokens": 9639.0,
      "step": 2957,
      "turn_loss": 0.43429169058799744,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 33310.0,
      "epoch": 0.1374279873629437,
      "grad_norm": 0.6271669864654541,
      "learning_rate": 8.657670131503959e-06,
      "loss": 0.209,
      "mae_dtheta": 0.03260671719908714,
      "mae_dx": 0.012465288862586021,
      "mae_dy": 0.005179225467145443,
      "pose_mae_dtheta": 0.26102524995803833,
      "pose_mae_dx": 0.10395783185958862,
      "pose_mae_dy": 0.07057922333478928,
      "pose_rmse_dtheta": 0.45193934440612793,
      "pose_rmse_dx": 0.23595546185970306,
      "pose_rmse_dy": 0.16367477178573608,
      "pose_rmse_mean": 0.2838565409183502,
      "rmse_dtheta": 0.05097275227308273,
      "rmse_dx": 0.026063308119773865,
      "rmse_dy": 0.010049566626548767,
      "rmse_mean": 0.02902854233980179,
      "rotation_flip": 0.009861933067440987,
      "sparse_tokens": 27298.0,
      "step": 2958,
      "turn_loss": 0.2792791426181793,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.13747444712878648,
      "grad_norm": 0.6690049171447754,
      "learning_rate": 8.656768508095853e-06,
      "loss": 0.1545,
      "mae_dtheta": 0.015166903845965862,
      "mae_dx": 0.001967713236808777,
      "mae_dy": 0.003791136434301734,
      "pose_mae_dtheta": 0.10577526688575745,
      "pose_mae_dx": 0.03389959782361984,
      "pose_mae_dy": 0.04729548841714859,
      "pose_rmse_dtheta": 0.233892560005188,
      "pose_rmse_dx": 0.08585739135742188,
      "pose_rmse_dy": 0.13571752607822418,
      "pose_rmse_mean": 0.15182249248027802,
      "rmse_dtheta": 0.027983693405985832,
      "rmse_dx": 0.00521097844466567,
      "rmse_dy": 0.007708144839853048,
      "rmse_mean": 0.013634271919727325,
      "rotation_flip": 0.0047538201324641705,
      "sparse_tokens": 32105.0,
      "step": 2959,
      "turn_loss": 0.13440416753292084,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.13752090689462926,
      "grad_norm": 0.5848970413208008,
      "learning_rate": 8.655866628967964e-06,
      "loss": 0.1572,
      "mae_dtheta": 0.03223053365945816,
      "mae_dx": 0.009014677256345749,
      "mae_dy": 0.007578461896628141,
      "pose_mae_dtheta": 0.24792136251926422,
      "pose_mae_dx": 0.062070295214653015,
      "pose_mae_dy": 0.0788794606924057,
      "pose_rmse_dtheta": 0.46556511521339417,
      "pose_rmse_dx": 0.14135678112506866,
      "pose_rmse_dy": 0.18500933051109314,
      "pose_rmse_mean": 0.2639771103858948,
      "rmse_dtheta": 0.05171132832765579,
      "rmse_dx": 0.020245935767889023,
      "rmse_dy": 0.016037169843912125,
      "rmse_mean": 0.029331475496292114,
      "rotation_flip": 0.009287925437092781,
      "sparse_tokens": 18541.0,
      "step": 2960,
      "turn_loss": 0.29026225209236145,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.13756736666047203,
      "grad_norm": 0.5812301635742188,
      "learning_rate": 8.65496449418336e-06,
      "loss": 0.1182,
      "mae_dtheta": 0.009956964291632175,
      "mae_dx": 0.0019210000755265355,
      "mae_dy": 0.0012191316345706582,
      "pose_mae_dtheta": 0.07040399312973022,
      "pose_mae_dx": 0.0168886911123991,
      "pose_mae_dy": 0.01885353773832321,
      "pose_rmse_dtheta": 0.23621106147766113,
      "pose_rmse_dx": 0.04331399127840996,
      "pose_rmse_dy": 0.03971721604466438,
      "pose_rmse_mean": 0.10641409456729889,
      "rmse_dtheta": 0.027193695306777954,
      "rmse_dx": 0.005546856205910444,
      "rmse_dy": 0.002451520413160324,
      "rmse_mean": 0.01173069141805172,
      "rotation_flip": 0.004670714493840933,
      "sparse_tokens": 32137.0,
      "step": 2961,
      "turn_loss": 0.06888017803430557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1376138264263148,
      "grad_norm": 0.5915555357933044,
      "learning_rate": 8.654062103805126e-06,
      "loss": 0.1598,
      "mae_dtheta": 0.01109081320464611,
      "mae_dx": 0.0021834231447428465,
      "mae_dy": 0.0018919726135209203,
      "pose_mae_dtheta": 0.08381791412830353,
      "pose_mae_dx": 0.028261223807930946,
      "pose_mae_dy": 0.033235613256692886,
      "pose_rmse_dtheta": 0.20570209622383118,
      "pose_rmse_dx": 0.07140763103961945,
      "pose_rmse_dy": 0.08243004977703094,
      "pose_rmse_mean": 0.11984660476446152,
      "rmse_dtheta": 0.02319451794028282,
      "rmse_dx": 0.007177345920354128,
      "rmse_dy": 0.004163417499512434,
      "rmse_mean": 0.011511760763823986,
      "rotation_flip": 0.0021431632339954376,
      "sparse_tokens": 32057.0,
      "step": 2962,
      "turn_loss": 0.09403122961521149,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1376602861921576,
      "grad_norm": 0.5427127480506897,
      "learning_rate": 8.653159457896367e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.012346876785159111,
      "mae_dx": 0.0019307705806568265,
      "mae_dy": 0.0022121260408312082,
      "pose_mae_dtheta": 0.08609982579946518,
      "pose_mae_dx": 0.02351018786430359,
      "pose_mae_dy": 0.029507936909794807,
      "pose_rmse_dtheta": 0.2338191717863083,
      "pose_rmse_dx": 0.05374627187848091,
      "pose_rmse_dy": 0.06856733560562134,
      "pose_rmse_mean": 0.11871092766523361,
      "rmse_dtheta": 0.026804374530911446,
      "rmse_dx": 0.0059473649598658085,
      "rmse_dy": 0.004669470712542534,
      "rmse_mean": 0.012473737820982933,
      "rotation_flip": 0.0037579857744276524,
      "sparse_tokens": 32121.0,
      "step": 2963,
      "turn_loss": 0.08485586941242218,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.13770674595800036,
      "grad_norm": 0.3511546850204468,
      "learning_rate": 8.65225655652021e-06,
      "loss": 0.0872,
      "mae_dtheta": 0.041213758289813995,
      "mae_dx": 0.010259466245770454,
      "mae_dy": 0.003997737541794777,
      "pose_mae_dtheta": 0.30577921867370605,
      "pose_mae_dx": 0.09092417359352112,
      "pose_mae_dy": 0.05937796086072922,
      "pose_rmse_dtheta": 0.5694496631622314,
      "pose_rmse_dx": 0.2237233966588974,
      "pose_rmse_dy": 0.14019040763378143,
      "pose_rmse_mean": 0.3111211657524109,
      "rmse_dtheta": 0.06553822010755539,
      "rmse_dx": 0.02429451234638691,
      "rmse_dy": 0.007589653134346008,
      "rmse_mean": 0.032474130392074585,
      "rotation_flip": 0.013944223523139954,
      "sparse_tokens": 7322.0,
      "step": 2964,
      "turn_loss": 0.22047577798366547,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 29108.0,
      "epoch": 0.13775320572384314,
      "grad_norm": 0.635368287563324,
      "learning_rate": 8.651353399739787e-06,
      "loss": 0.2298,
      "mae_dtheta": 0.041378285735845566,
      "mae_dx": 0.01314803771674633,
      "mae_dy": 0.0056238723918795586,
      "pose_mae_dtheta": 0.3160504102706909,
      "pose_mae_dx": 0.09992266446352005,
      "pose_mae_dy": 0.06885413080453873,
      "pose_rmse_dtheta": 0.5309950113296509,
      "pose_rmse_dx": 0.2228575497865677,
      "pose_rmse_dy": 0.16276288032531738,
      "pose_rmse_mean": 0.30553847551345825,
      "rmse_dtheta": 0.06022365391254425,
      "rmse_dx": 0.02511030063033104,
      "rmse_dy": 0.011688564904034138,
      "rmse_mean": 0.032340843230485916,
      "rotation_flip": 0.009715475142002106,
      "sparse_tokens": 21988.0,
      "step": 2965,
      "turn_loss": 0.3007392883300781,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.13779966548968592,
      "grad_norm": 0.6588099598884583,
      "learning_rate": 8.650449987618263e-06,
      "loss": 0.2131,
      "mae_dtheta": 0.048542674630880356,
      "mae_dx": 0.011609005741775036,
      "mae_dy": 0.007848910056054592,
      "pose_mae_dtheta": 0.40470409393310547,
      "pose_mae_dx": 0.10118338465690613,
      "pose_mae_dy": 0.07015448063611984,
      "pose_rmse_dtheta": 0.6577266454696655,
      "pose_rmse_dx": 0.2584027945995331,
      "pose_rmse_dy": 0.18417154252529144,
      "pose_rmse_mean": 0.366767019033432,
      "rmse_dtheta": 0.06833186745643616,
      "rmse_dx": 0.024032751098275185,
      "rmse_dy": 0.01958656869828701,
      "rmse_mean": 0.03731706365942955,
      "rotation_flip": 0.014414414763450623,
      "sparse_tokens": 8944.0,
      "step": 2966,
      "turn_loss": 0.4375448226928711,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 40239.0,
      "epoch": 0.13784612525552872,
      "grad_norm": 0.6108453869819641,
      "learning_rate": 8.649546320218813e-06,
      "loss": 0.1478,
      "mae_dtheta": 0.03457941487431526,
      "mae_dx": 0.012974242679774761,
      "mae_dy": 0.005244238767772913,
      "pose_mae_dtheta": 0.274748831987381,
      "pose_mae_dx": 0.10437140613794327,
      "pose_mae_dy": 0.05511835590004921,
      "pose_rmse_dtheta": 0.5133035778999329,
      "pose_rmse_dx": 0.2341030091047287,
      "pose_rmse_dy": 0.15021474659442902,
      "pose_rmse_mean": 0.2992071211338043,
      "rmse_dtheta": 0.054591044783592224,
      "rmse_dx": 0.025112241506576538,
      "rmse_dy": 0.011507522314786911,
      "rmse_mean": 0.030403604730963707,
      "rotation_flip": 0.011992005631327629,
      "sparse_tokens": 25180.0,
      "step": 2967,
      "turn_loss": 0.2716776728630066,
      "turns": 124.0,
      "turns_per_sample": 124.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.1378925850213715,
      "grad_norm": 0.5582358837127686,
      "learning_rate": 8.64864239760463e-06,
      "loss": 0.1667,
      "mae_dtheta": 0.049726780503988266,
      "mae_dx": 0.008751084096729755,
      "mae_dy": 0.0053911167196929455,
      "pose_mae_dtheta": 0.4544502794742584,
      "pose_mae_dx": 0.08228293061256409,
      "pose_mae_dy": 0.07045190036296844,
      "pose_rmse_dtheta": 0.7856639623641968,
      "pose_rmse_dx": 0.17901621758937836,
      "pose_rmse_dy": 0.1723707914352417,
      "pose_rmse_mean": 0.3790169954299927,
      "rmse_dtheta": 0.07561935484409332,
      "rmse_dx": 0.01784302294254303,
      "rmse_dy": 0.012850425206124783,
      "rmse_mean": 0.035437602549791336,
      "rotation_flip": 0.009900989942252636,
      "sparse_tokens": 5826.0,
      "step": 2968,
      "turn_loss": 0.3157697021961212,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.13793904478721428,
      "grad_norm": 0.48342230916023254,
      "learning_rate": 8.647738219838924e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.011231495998799801,
      "mae_dx": 0.0026516003999859095,
      "mae_dy": 0.002592249773442745,
      "pose_mae_dtheta": 0.08370064944028854,
      "pose_mae_dx": 0.025930875912308693,
      "pose_mae_dy": 0.030763359740376472,
      "pose_rmse_dtheta": 0.19405966997146606,
      "pose_rmse_dx": 0.0734008401632309,
      "pose_rmse_dy": 0.07545815408229828,
      "pose_rmse_mean": 0.11430623382329941,
      "rmse_dtheta": 0.023303823545575142,
      "rmse_dx": 0.00816273596137762,
      "rmse_dy": 0.0069456323981285095,
      "rmse_mean": 0.012804063968360424,
      "rotation_flip": 0.0033769523724913597,
      "sparse_tokens": 32137.0,
      "step": 2969,
      "turn_loss": 0.09627335518598557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.13798550455305705,
      "grad_norm": 0.4531220495700836,
      "learning_rate": 8.646833786984927e-06,
      "loss": 0.1458,
      "mae_dtheta": 0.03698325902223587,
      "mae_dx": 0.01505181286484003,
      "mae_dy": 0.004296076484024525,
      "pose_mae_dtheta": 0.29757803678512573,
      "pose_mae_dx": 0.133976012468338,
      "pose_mae_dy": 0.057873282581567764,
      "pose_rmse_dtheta": 0.5095162391662598,
      "pose_rmse_dx": 0.2906704545021057,
      "pose_rmse_dy": 0.11918823421001434,
      "pose_rmse_mean": 0.30645832419395447,
      "rmse_dtheta": 0.05435786023736,
      "rmse_dx": 0.02847442403435707,
      "rmse_dy": 0.00791869219392538,
      "rmse_mean": 0.030250325798988342,
      "rotation_flip": 0.012371134012937546,
      "sparse_tokens": 15129.0,
      "step": 2970,
      "turn_loss": 0.2589918375015259,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.13803196431889983,
      "grad_norm": 0.6120797395706177,
      "learning_rate": 8.645929099105886e-06,
      "loss": 0.2095,
      "mae_dtheta": 0.014069694094359875,
      "mae_dx": 0.0020536896772682667,
      "mae_dy": 0.003583490615710616,
      "pose_mae_dtheta": 0.10094335675239563,
      "pose_mae_dx": 0.034571077674627304,
      "pose_mae_dy": 0.04101447016000748,
      "pose_rmse_dtheta": 0.24302440881729126,
      "pose_rmse_dx": 0.0836012214422226,
      "pose_rmse_dy": 0.09493608772754669,
      "pose_rmse_mean": 0.14052057266235352,
      "rmse_dtheta": 0.028101060539484024,
      "rmse_dx": 0.00519184535369277,
      "rmse_dy": 0.007300032768398523,
      "rmse_mean": 0.013530979864299297,
      "rotation_flip": 0.004804612603038549,
      "sparse_tokens": 32121.0,
      "step": 2971,
      "turn_loss": 0.1122506856918335,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1380784240847426,
      "grad_norm": 0.44747596979141235,
      "learning_rate": 8.645024156265066e-06,
      "loss": 0.122,
      "mae_dtheta": 0.01239019725471735,
      "mae_dx": 0.002081718295812607,
      "mae_dy": 0.0020042818505316973,
      "pose_mae_dtheta": 0.08725026994943619,
      "pose_mae_dx": 0.02126794122159481,
      "pose_mae_dy": 0.022442955523729324,
      "pose_rmse_dtheta": 0.26283785700798035,
      "pose_rmse_dx": 0.051949016749858856,
      "pose_rmse_dy": 0.05823185667395592,
      "pose_rmse_mean": 0.12433958053588867,
      "rmse_dtheta": 0.030568009242415428,
      "rmse_dx": 0.0057835509069263935,
      "rmse_dy": 0.004807255696505308,
      "rmse_mean": 0.013719606213271618,
      "rotation_flip": 0.0041806017979979515,
      "sparse_tokens": 32169.0,
      "step": 2972,
      "turn_loss": 0.08824741840362549,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.13812488385058538,
      "grad_norm": 0.4293045699596405,
      "learning_rate": 8.644118958525753e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.01246002409607172,
      "mae_dx": 0.0014651556266471744,
      "mae_dy": 0.0029463423416018486,
      "pose_mae_dtheta": 0.0868302583694458,
      "pose_mae_dx": 0.028525808826088905,
      "pose_mae_dy": 0.03953371196985245,
      "pose_rmse_dtheta": 0.20666995644569397,
      "pose_rmse_dx": 0.06661661714315414,
      "pose_rmse_dy": 0.08401565253734589,
      "pose_rmse_mean": 0.11910074949264526,
      "rmse_dtheta": 0.0246463380753994,
      "rmse_dx": 0.004219746682792902,
      "rmse_dy": 0.005693784449249506,
      "rmse_mean": 0.011519956402480602,
      "rotation_flip": 0.0032409075647592545,
      "sparse_tokens": 32073.0,
      "step": 2973,
      "turn_loss": 0.08920378983020782,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.13817134361642816,
      "grad_norm": 0.6065473556518555,
      "learning_rate": 8.643213505951242e-06,
      "loss": 0.1973,
      "mae_dtheta": 0.04091677814722061,
      "mae_dx": 0.011720183305442333,
      "mae_dy": 0.005340414587408304,
      "pose_mae_dtheta": 0.32209840416908264,
      "pose_mae_dx": 0.11419462412595749,
      "pose_mae_dy": 0.04822428524494171,
      "pose_rmse_dtheta": 0.557061493396759,
      "pose_rmse_dx": 0.24523058533668518,
      "pose_rmse_dy": 0.11454171687364578,
      "pose_rmse_mean": 0.3056112825870514,
      "rmse_dtheta": 0.06071098893880844,
      "rmse_dx": 0.02383369766175747,
      "rmse_dy": 0.011691978201270103,
      "rmse_mean": 0.03207889199256897,
      "rotation_flip": 0.01293103490024805,
      "sparse_tokens": 14113.0,
      "step": 2974,
      "turn_loss": 0.2642183005809784,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 8139.0,
      "epoch": 0.13821780338227097,
      "grad_norm": 0.5936486721038818,
      "learning_rate": 8.642307798604856e-06,
      "loss": 0.1497,
      "mae_dtheta": 0.034013260155916214,
      "mae_dx": 0.010055872611701488,
      "mae_dy": 0.005297913681715727,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5936486721038818,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.2183380126953,
      "model/head/act_norm_mean": 108.72669921875,
      "model/head/act_norm_min": 79.1581039428711,
      "model/head/act_over_embed": 74.7180056185206,
      "model/head/grad_frac": 0.09941081702709198,
      "model/head/grad_norm": 0.059015098959207535,
      "model/head/grad_zero_frac": 0.00016847130609676242,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.689765625,
      "model/head/update_ratio": 0.0010186120634898543,
      "model/head/weight_delta": 6.385200500488281,
      "model/head/weight_delta_rel": 0.11201532930135727,
      "model/head/weight_norm": 57.9367790222168,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4160885810852051,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41603968693659854,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41599759459495544,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28590636788774676,
      "model/modality_embedder.encoders.pose/grad_frac": 0.15505605936050415,
      "model/modality_embedder.encoders.pose/grad_norm": 0.09204882383346558,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5338792067307693,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0029867535922676325,
      "model/modality_embedder.encoders.pose/weight_delta": 2.089073896408081,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06825655698776245,
      "model/modality_embedder.encoders.pose/weight_norm": 30.819021224975586,
      "model/modality_embedder/grad_frac": 0.15505605936050415,
      "model/modality_embedder/grad_norm": 0.09204882383346558,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5338792067307693,
      "model/modality_embedder/update_ratio": 0.0029867535922676325,
      "model/modality_embedder/weight_delta": 2.089073896408081,
      "model/modality_embedder/weight_delta_rel": 0.06825655698776245,
      "model/modality_embedder/weight_norm": 30.819021224975586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.5636215209961,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.383323412698413,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.136083602905273,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.06923876732925,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08939267694950104,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05306784436106682,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019172680331394076,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.394744873046875,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.050825346261262894,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.67888641357422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.05337524414062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.277244543650795,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.887349128723145,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.683549737541213,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08772093057632446,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05207541584968567,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017777362372726202,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.7530077695846558,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.060725558549165726,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.293106079101562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.9868392944336,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.926679067460316,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.189152717590332,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.81705658455242,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0915362760424614,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.054340388625860214,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001797156990505755,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.8779890537261963,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06305935978889465,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.236862182617188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.97952270507812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.83581349206349,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.770101547241211,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.12903163473781,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09246275573968887,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05489039421081543,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018551477696746588,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.603179931640625,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05478908121585846,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.588151931762695,
      "model/normalizer/grad_frac": 0.3795415163040161,
      "model/normalizer/grad_norm": 0.22531431913375854,
      "model/normalizer/grad_zero_frac": 0.0002079859550576657,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002884073182940483,
      "model/normalizer/weight_delta": 3.4132025241851807,
      "model/normalizer/weight_delta_rel": 0.043960072100162506,
      "model/normalizer/weight_norm": 78.12364959716797,
      "pose_mae_dtheta": 0.26840248703956604,
      "pose_mae_dx": 0.056031808257102966,
      "pose_mae_dy": 0.07336696982383728,
      "pose_rmse_dtheta": 0.4635712504386902,
      "pose_rmse_dx": 0.14177778363227844,
      "pose_rmse_dy": 0.17076745629310608,
      "pose_rmse_mean": 0.2587054967880249,
      "rmse_dtheta": 0.05162535980343819,
      "rmse_dx": 0.02303873561322689,
      "rmse_dy": 0.010031280107796192,
      "rmse_mean": 0.028231792151927948,
      "rotation_flip": 0.015424164943397045,
      "sparse_tokens": 6871.0,
      "step": 2975,
      "turn_loss": 0.20187930762767792,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.13826426314811374,
      "grad_norm": 0.6933541893959045,
      "learning_rate": 8.641401836549931e-06,
      "loss": 0.0828,
      "mae_dtheta": 0.03442439064383507,
      "mae_dx": 0.011319080367684364,
      "mae_dy": 0.0037986792158335447,
      "pose_mae_dtheta": 0.29619455337524414,
      "pose_mae_dx": 0.08209986239671707,
      "pose_mae_dy": 0.04185418784618378,
      "pose_rmse_dtheta": 0.5124923586845398,
      "pose_rmse_dx": 0.1898258477449417,
      "pose_rmse_dy": 0.11746378242969513,
      "pose_rmse_mean": 0.2732606530189514,
      "rmse_dtheta": 0.053411245346069336,
      "rmse_dx": 0.022609522566199303,
      "rmse_dy": 0.009796487167477608,
      "rmse_mean": 0.02860575169324875,
      "rotation_flip": 0.010282776318490505,
      "sparse_tokens": 5909.0,
      "step": 2976,
      "turn_loss": 0.1783369928598404,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.13831072291395652,
      "grad_norm": 0.5981693863868713,
      "learning_rate": 8.640495619849821e-06,
      "loss": 0.1073,
      "mae_dtheta": 0.010248835198581219,
      "mae_dx": 0.0024440025445073843,
      "mae_dy": 0.0028980912175029516,
      "pose_mae_dtheta": 0.07752987742424011,
      "pose_mae_dx": 0.03078998439013958,
      "pose_mae_dy": 0.02710855007171631,
      "pose_rmse_dtheta": 0.2025110423564911,
      "pose_rmse_dx": 0.0725775882601738,
      "pose_rmse_dy": 0.07316549122333527,
      "pose_rmse_mean": 0.11608471721410751,
      "rmse_dtheta": 0.02426447533071041,
      "rmse_dx": 0.005861496087163687,
      "rmse_dy": 0.006222896743565798,
      "rmse_mean": 0.01211628969758749,
      "rotation_flip": 0.005528680048882961,
      "sparse_tokens": 32185.0,
      "step": 2977,
      "turn_loss": 0.08156802505254745,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1383571826797993,
      "grad_norm": 0.4272385239601135,
      "learning_rate": 8.639589148567898e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.014716331847012043,
      "mae_dx": 0.003690893528982997,
      "mae_dy": 0.004734238609671593,
      "pose_mae_dtheta": 0.10653281956911087,
      "pose_mae_dx": 0.04677322879433632,
      "pose_mae_dy": 0.04827309399843216,
      "pose_rmse_dtheta": 0.24583451449871063,
      "pose_rmse_dx": 0.15579086542129517,
      "pose_rmse_dy": 0.11398536711931229,
      "pose_rmse_mean": 0.17187026143074036,
      "rmse_dtheta": 0.027623029425740242,
      "rmse_dx": 0.011971263214945793,
      "rmse_dy": 0.011709933169186115,
      "rmse_mean": 0.017101408913731575,
      "rotation_flip": 0.005597629118710756,
      "sparse_tokens": 32089.0,
      "step": 2978,
      "turn_loss": 0.13712210953235626,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.13840364244564207,
      "grad_norm": 0.641156792640686,
      "learning_rate": 8.638682422767554e-06,
      "loss": 0.1456,
      "mae_dtheta": 0.025414790958166122,
      "mae_dx": 0.010355481877923012,
      "mae_dy": 0.007549740374088287,
      "pose_mae_dtheta": 0.20496298372745514,
      "pose_mae_dx": 0.07298723608255386,
      "pose_mae_dy": 0.09454479068517685,
      "pose_rmse_dtheta": 0.36171430349349976,
      "pose_rmse_dx": 0.18940825760364532,
      "pose_rmse_dy": 0.2033742368221283,
      "pose_rmse_mean": 0.2514989376068115,
      "rmse_dtheta": 0.04002531245350838,
      "rmse_dx": 0.0226197000592947,
      "rmse_dy": 0.013886330649256706,
      "rmse_mean": 0.025510448962450027,
      "rotation_flip": 0.011807448230683804,
      "sparse_tokens": 21249.0,
      "step": 2979,
      "turn_loss": 0.24122267961502075,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.13845010221148485,
      "grad_norm": 0.43495476245880127,
      "learning_rate": 8.637775442512193e-06,
      "loss": 0.0969,
      "mae_dtheta": 0.025441331788897514,
      "mae_dx": 0.011371628381311893,
      "mae_dy": 0.0024502910673618317,
      "pose_mae_dtheta": 0.2151128053665161,
      "pose_mae_dx": 0.08660237491130829,
      "pose_mae_dy": 0.033440422266721725,
      "pose_rmse_dtheta": 0.4005224108695984,
      "pose_rmse_dx": 0.21859751641750336,
      "pose_rmse_dy": 0.08231043070554733,
      "pose_rmse_mean": 0.23381012678146362,
      "rmse_dtheta": 0.04300200194120407,
      "rmse_dx": 0.024805445224046707,
      "rmse_dy": 0.004941489547491074,
      "rmse_mean": 0.024249648675322533,
      "rotation_flip": 0.005565862637013197,
      "sparse_tokens": 12893.0,
      "step": 2980,
      "turn_loss": 0.18942558765411377,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 24264.0,
      "epoch": 0.13849656197732763,
      "grad_norm": 0.5547928810119629,
      "learning_rate": 8.636868207865244e-06,
      "loss": 0.1579,
      "mae_dtheta": 0.03982562944293022,
      "mae_dx": 0.009078660048544407,
      "mae_dy": 0.004826975986361504,
      "pose_mae_dtheta": 0.3261207342147827,
      "pose_mae_dx": 0.07013276219367981,
      "pose_mae_dy": 0.06718504428863525,
      "pose_rmse_dtheta": 0.5783687233924866,
      "pose_rmse_dx": 0.1579655408859253,
      "pose_rmse_dy": 0.16839110851287842,
      "pose_rmse_mean": 0.3015751242637634,
      "rmse_dtheta": 0.06017708405852318,
      "rmse_dx": 0.019651666283607483,
      "rmse_dy": 0.00936134159564972,
      "rmse_mean": 0.02973003312945366,
      "rotation_flip": 0.013840830884873867,
      "sparse_tokens": 18461.0,
      "step": 2981,
      "turn_loss": 0.2416246086359024,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.1385430217431704,
      "grad_norm": 0.5252615213394165,
      "learning_rate": 8.63596071889015e-06,
      "loss": 0.121,
      "mae_dtheta": 0.03175793215632439,
      "mae_dx": 0.009545724838972092,
      "mae_dy": 0.0033265058882534504,
      "pose_mae_dtheta": 0.24424543976783752,
      "pose_mae_dx": 0.08078528195619583,
      "pose_mae_dy": 0.04757427051663399,
      "pose_rmse_dtheta": 0.4052368402481079,
      "pose_rmse_dx": 0.20947714149951935,
      "pose_rmse_dy": 0.11557257175445557,
      "pose_rmse_mean": 0.24342885613441467,
      "rmse_dtheta": 0.0479918047785759,
      "rmse_dx": 0.021216748282313347,
      "rmse_dy": 0.005838328506797552,
      "rmse_mean": 0.025015627965331078,
      "rotation_flip": 0.012224938720464706,
      "sparse_tokens": 6908.0,
      "step": 2982,
      "turn_loss": 0.26946935057640076,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1385894815090132,
      "grad_norm": 0.4511714577674866,
      "learning_rate": 8.63505297565037e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.016537383198738098,
      "mae_dx": 0.0020884042605757713,
      "mae_dy": 0.003938371315598488,
      "pose_mae_dtheta": 0.1125178411602974,
      "pose_mae_dx": 0.0354563370347023,
      "pose_mae_dy": 0.052844300866127014,
      "pose_rmse_dtheta": 0.2193690985441208,
      "pose_rmse_dx": 0.07647103816270828,
      "pose_rmse_dy": 0.1130535900592804,
      "pose_rmse_mean": 0.13629791140556335,
      "rmse_dtheta": 0.029901020228862762,
      "rmse_dx": 0.0051477691158652306,
      "rmse_dy": 0.007457147818058729,
      "rmse_mean": 0.014168646186590195,
      "rotation_flip": 0.01253045629709959,
      "sparse_tokens": 32057.0,
      "step": 2983,
      "turn_loss": 0.136781707406044,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4563.0,
      "epoch": 0.13863594127485598,
      "grad_norm": 0.9339126348495483,
      "learning_rate": 8.634144978209385e-06,
      "loss": 0.2379,
      "mae_dtheta": 0.032674990594387054,
      "mae_dx": 0.014096560887992382,
      "mae_dy": 0.006955146323889494,
      "pose_mae_dtheta": 0.23517030477523804,
      "pose_mae_dx": 0.11665977537631989,
      "pose_mae_dy": 0.11775697022676468,
      "pose_rmse_dtheta": 0.3719242513179779,
      "pose_rmse_dx": 0.2624175548553467,
      "pose_rmse_dy": 0.2266639918088913,
      "pose_rmse_mean": 0.28700196743011475,
      "rmse_dtheta": 0.04575212299823761,
      "rmse_dx": 0.029571931809186935,
      "rmse_dy": 0.010503757745027542,
      "rmse_mean": 0.028609272092580795,
      "rotation_flip": 0.008130080997943878,
      "sparse_tokens": 3831.0,
      "step": 2984,
      "turn_loss": 0.2454780638217926,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13868240104069876,
      "grad_norm": 0.40285950899124146,
      "learning_rate": 8.633236726630689e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.009267957881093025,
      "mae_dx": 0.0014386239927262068,
      "mae_dy": 0.0020481792744249105,
      "pose_mae_dtheta": 0.06419719010591507,
      "pose_mae_dx": 0.02039474807679653,
      "pose_mae_dy": 0.027741724625229836,
      "pose_rmse_dtheta": 0.12410962581634521,
      "pose_rmse_dx": 0.04875106364488602,
      "pose_rmse_dy": 0.062436848878860474,
      "pose_rmse_mean": 0.07843251526355743,
      "rmse_dtheta": 0.017469914630055428,
      "rmse_dx": 0.004167350474745035,
      "rmse_dy": 0.004454536363482475,
      "rmse_mean": 0.0086972676217556,
      "rotation_flip": 0.002387584652751684,
      "sparse_tokens": 32089.0,
      "step": 2985,
      "turn_loss": 0.07704412937164307,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13872886080654154,
      "grad_norm": 0.477395236492157,
      "learning_rate": 8.632328220977801e-06,
      "loss": 0.0764,
      "mae_dtheta": 0.007483622524887323,
      "mae_dx": 0.0013094902969896793,
      "mae_dy": 0.0012338911183178425,
      "pose_mae_dtheta": 0.053770098835229874,
      "pose_mae_dx": 0.014750159345567226,
      "pose_mae_dy": 0.020932916551828384,
      "pose_rmse_dtheta": 0.1387622058391571,
      "pose_rmse_dx": 0.03887326270341873,
      "pose_rmse_dy": 0.053093280643224716,
      "pose_rmse_mean": 0.07690958678722382,
      "rmse_dtheta": 0.01744585670530796,
      "rmse_dx": 0.004458309151232243,
      "rmse_dy": 0.0025976840406656265,
      "rmse_mean": 0.008167283609509468,
      "rotation_flip": 0.0037154988385736942,
      "sparse_tokens": 32089.0,
      "step": 2986,
      "turn_loss": 0.05827737972140312,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.13877532057238431,
      "grad_norm": 0.6214255690574646,
      "learning_rate": 8.63141946131425e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.00816091988235712,
      "mae_dx": 0.0025203595869243145,
      "mae_dy": 0.0019332885276526213,
      "pose_mae_dtheta": 0.062121402472257614,
      "pose_mae_dx": 0.028705526143312454,
      "pose_mae_dy": 0.025029249489307404,
      "pose_rmse_dtheta": 0.1892176866531372,
      "pose_rmse_dx": 0.11299102008342743,
      "pose_rmse_dy": 0.08565820753574371,
      "pose_rmse_mean": 0.12928897142410278,
      "rmse_dtheta": 0.02122487500309944,
      "rmse_dx": 0.009507758542895317,
      "rmse_dy": 0.006253035739064217,
      "rmse_mean": 0.01232855673879385,
      "rotation_flip": 0.002939015394076705,
      "sparse_tokens": 32041.0,
      "step": 2987,
      "turn_loss": 0.07690044492483139,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23295.0,
      "epoch": 0.1388217803382271,
      "grad_norm": 0.5379725098609924,
      "learning_rate": 8.630510447703588e-06,
      "loss": 0.1524,
      "mae_dtheta": 0.029102282598614693,
      "mae_dx": 0.01454964093863964,
      "mae_dy": 0.004501348827034235,
      "pose_mae_dtheta": 0.24549593031406403,
      "pose_mae_dx": 0.12137189507484436,
      "pose_mae_dy": 0.05971953272819519,
      "pose_rmse_dtheta": 0.4016210436820984,
      "pose_rmse_dx": 0.26314669847488403,
      "pose_rmse_dy": 0.13075906038284302,
      "pose_rmse_mean": 0.26517561078071594,
      "rmse_dtheta": 0.04308304190635681,
      "rmse_dx": 0.027767496183514595,
      "rmse_dy": 0.008913246914744377,
      "rmse_mean": 0.02658792957663536,
      "rotation_flip": 0.007984031923115253,
      "sparse_tokens": 17168.0,
      "step": 2988,
      "turn_loss": 0.30321574211120605,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.13886824010406987,
      "grad_norm": 0.5393205285072327,
      "learning_rate": 8.629601180209382e-06,
      "loss": 0.0867,
      "mae_dtheta": 0.02805650793015957,
      "mae_dx": 0.011383617296814919,
      "mae_dy": 0.004923058208078146,
      "pose_mae_dtheta": 0.20788951218128204,
      "pose_mae_dx": 0.08906533569097519,
      "pose_mae_dy": 0.06147244572639465,
      "pose_rmse_dtheta": 0.3792944848537445,
      "pose_rmse_dx": 0.2046447992324829,
      "pose_rmse_dy": 0.13890832662582397,
      "pose_rmse_mean": 0.24094921350479126,
      "rmse_dtheta": 0.044369492679834366,
      "rmse_dx": 0.024097805842757225,
      "rmse_dy": 0.009229632094502449,
      "rmse_mean": 0.025898976251482964,
      "rotation_flip": 0.0043196543119847775,
      "sparse_tokens": 15956.0,
      "step": 2989,
      "turn_loss": 0.2489137351512909,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.13891469986991264,
      "grad_norm": 0.3887597620487213,
      "learning_rate": 8.628691658895215e-06,
      "loss": 0.0838,
      "mae_dtheta": 0.008725564926862717,
      "mae_dx": 0.0018044766038656235,
      "mae_dy": 0.0016256754752248526,
      "pose_mae_dtheta": 0.05766984075307846,
      "pose_mae_dx": 0.017833445221185684,
      "pose_mae_dy": 0.022393668070435524,
      "pose_rmse_dtheta": 0.14998812973499298,
      "pose_rmse_dx": 0.049256544560194016,
      "pose_rmse_dy": 0.050782497972249985,
      "pose_rmse_mean": 0.08334239572286606,
      "rmse_dtheta": 0.019408276304602623,
      "rmse_dx": 0.0060205599293112755,
      "rmse_dy": 0.004013171419501305,
      "rmse_mean": 0.009814002551138401,
      "rotation_flip": 0.0014231499517336488,
      "sparse_tokens": 32137.0,
      "step": 2990,
      "turn_loss": 0.07911151647567749,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13896115963575545,
      "grad_norm": 0.7169785499572754,
      "learning_rate": 8.627781883824694e-06,
      "loss": 0.1215,
      "mae_dtheta": 0.014362486079335213,
      "mae_dx": 0.0019656724762171507,
      "mae_dy": 0.0031037956941872835,
      "pose_mae_dtheta": 0.0983625277876854,
      "pose_mae_dx": 0.030182644724845886,
      "pose_mae_dy": 0.04023318365216255,
      "pose_rmse_dtheta": 0.2089684009552002,
      "pose_rmse_dx": 0.06626328080892563,
      "pose_rmse_dy": 0.09039898216724396,
      "pose_rmse_mean": 0.12187689542770386,
      "rmse_dtheta": 0.02612180821597576,
      "rmse_dx": 0.005438667256385088,
      "rmse_dy": 0.005953711457550526,
      "rmse_mean": 0.012504729442298412,
      "rotation_flip": 0.005045408848673105,
      "sparse_tokens": 32089.0,
      "step": 2991,
      "turn_loss": 0.12108811736106873,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.13900761940159823,
      "grad_norm": 0.7387422323226929,
      "learning_rate": 8.626871855061438e-06,
      "loss": 0.2026,
      "mae_dtheta": 0.041618019342422485,
      "mae_dx": 0.011086520738899708,
      "mae_dy": 0.003876687493175268,
      "pose_mae_dtheta": 0.33160558342933655,
      "pose_mae_dx": 0.0812077522277832,
      "pose_mae_dy": 0.03757687285542488,
      "pose_rmse_dtheta": 0.5852897763252258,
      "pose_rmse_dx": 0.18184997141361237,
      "pose_rmse_dy": 0.1180165484547615,
      "pose_rmse_mean": 0.29505211114883423,
      "rmse_dtheta": 0.06199366971850395,
      "rmse_dx": 0.02250838279724121,
      "rmse_dy": 0.008314046077430248,
      "rmse_mean": 0.03093869984149933,
      "rotation_flip": 0.007002801168709993,
      "sparse_tokens": 11610.0,
      "step": 2992,
      "turn_loss": 0.2736278772354126,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.139054079167441,
      "grad_norm": 0.5085985064506531,
      "learning_rate": 8.625961572669087e-06,
      "loss": 0.1373,
      "mae_dtheta": 0.0346529483795166,
      "mae_dx": 0.0048227193765342236,
      "mae_dy": 0.003723112167790532,
      "pose_mae_dtheta": 0.3088113069534302,
      "pose_mae_dx": 0.03884120285511017,
      "pose_mae_dy": 0.033053379505872726,
      "pose_rmse_dtheta": 0.5969666838645935,
      "pose_rmse_dx": 0.07452510297298431,
      "pose_rmse_dy": 0.08103463798761368,
      "pose_rmse_mean": 0.2508421540260315,
      "rmse_dtheta": 0.057617101818323135,
      "rmse_dx": 0.010658266954123974,
      "rmse_dy": 0.007464156951755285,
      "rmse_mean": 0.025246508419513702,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 3221.0,
      "step": 2993,
      "turn_loss": 0.19118110835552216,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.13910053893328378,
      "grad_norm": 0.3075738251209259,
      "learning_rate": 8.625051036711298e-06,
      "loss": 0.0756,
      "mae_dtheta": 0.028175868093967438,
      "mae_dx": 0.008824422955513,
      "mae_dy": 0.004920472390949726,
      "pose_mae_dtheta": 0.24398073554039001,
      "pose_mae_dx": 0.07306351512670517,
      "pose_mae_dy": 0.05465257167816162,
      "pose_rmse_dtheta": 0.44889169931411743,
      "pose_rmse_dx": 0.15317262709140778,
      "pose_rmse_dy": 0.13705168664455414,
      "pose_rmse_mean": 0.2463720142841339,
      "rmse_dtheta": 0.046940095722675323,
      "rmse_dx": 0.01965295523405075,
      "rmse_dy": 0.009191666729748249,
      "rmse_mean": 0.025261573493480682,
      "rotation_flip": 0.015355085954070091,
      "sparse_tokens": 9161.0,
      "step": 2994,
      "turn_loss": 0.17114198207855225,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.13914699869912656,
      "grad_norm": 0.7969635725021362,
      "learning_rate": 8.624140247251745e-06,
      "loss": 0.2626,
      "mae_dtheta": 0.04160947725176811,
      "mae_dx": 0.0121084563434124,
      "mae_dy": 0.006058915983885527,
      "pose_mae_dtheta": 0.34705933928489685,
      "pose_mae_dx": 0.09333980828523636,
      "pose_mae_dy": 0.07603190839290619,
      "pose_rmse_dtheta": 0.5751778483390808,
      "pose_rmse_dx": 0.20522350072860718,
      "pose_rmse_dy": 0.18068210780620575,
      "pose_rmse_mean": 0.3203611671924591,
      "rmse_dtheta": 0.05914153531193733,
      "rmse_dx": 0.02453489415347576,
      "rmse_dy": 0.012871410697698593,
      "rmse_mean": 0.032182615250349045,
      "rotation_flip": 0.01666666753590107,
      "sparse_tokens": 15775.0,
      "step": 2995,
      "turn_loss": 0.29220205545425415,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.13919345846496933,
      "grad_norm": 0.6942453384399414,
      "learning_rate": 8.623229204354117e-06,
      "loss": 0.11,
      "mae_dtheta": 0.01158058736473322,
      "mae_dx": 0.001673733931966126,
      "mae_dy": 0.002828404074534774,
      "pose_mae_dtheta": 0.07672686874866486,
      "pose_mae_dx": 0.02452903613448143,
      "pose_mae_dy": 0.03587505593895912,
      "pose_rmse_dtheta": 0.1674322932958603,
      "pose_rmse_dx": 0.060291752219200134,
      "pose_rmse_dy": 0.0741758942604065,
      "pose_rmse_mean": 0.10063331574201584,
      "rmse_dtheta": 0.022219659760594368,
      "rmse_dx": 0.0055214413441717625,
      "rmse_dy": 0.005972817540168762,
      "rmse_mean": 0.011237973347306252,
      "rotation_flip": 0.005177514627575874,
      "sparse_tokens": 32057.0,
      "step": 2996,
      "turn_loss": 0.0837976485490799,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1392399182308121,
      "grad_norm": 0.653410792350769,
      "learning_rate": 8.622317908082127e-06,
      "loss": 0.134,
      "mae_dtheta": 0.015608454123139381,
      "mae_dx": 0.0030074608512222767,
      "mae_dy": 0.004169829655438662,
      "pose_mae_dtheta": 0.1098242700099945,
      "pose_mae_dx": 0.036340221762657166,
      "pose_mae_dy": 0.04490099102258682,
      "pose_rmse_dtheta": 0.23332826793193817,
      "pose_rmse_dx": 0.08902871608734131,
      "pose_rmse_dy": 0.10089164972305298,
      "pose_rmse_mean": 0.14108288288116455,
      "rmse_dtheta": 0.029714060947299004,
      "rmse_dx": 0.008329362608492374,
      "rmse_dy": 0.009482644498348236,
      "rmse_mean": 0.015842024236917496,
      "rotation_flip": 0.01175680197775364,
      "sparse_tokens": 32137.0,
      "step": 2997,
      "turn_loss": 0.13394396007061005,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1392863779966549,
      "grad_norm": 0.5761184692382812,
      "learning_rate": 8.621406358499502e-06,
      "loss": 0.1539,
      "mae_dtheta": 0.011848237365484238,
      "mae_dx": 0.0020148453768342733,
      "mae_dy": 0.0034260665997862816,
      "pose_mae_dtheta": 0.07835179567337036,
      "pose_mae_dx": 0.030782517045736313,
      "pose_mae_dy": 0.04102398455142975,
      "pose_rmse_dtheta": 0.14881959557533264,
      "pose_rmse_dx": 0.07095646113157272,
      "pose_rmse_dy": 0.08560687303543091,
      "pose_rmse_mean": 0.10179431736469269,
      "rmse_dtheta": 0.02163487859070301,
      "rmse_dx": 0.005412166006863117,
      "rmse_dy": 0.006966606713831425,
      "rmse_mean": 0.01133788377046585,
      "rotation_flip": 0.004736130125820637,
      "sparse_tokens": 32105.0,
      "step": 2998,
      "turn_loss": 0.0853675901889801,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.13933283776249766,
      "grad_norm": 0.43205031752586365,
      "learning_rate": 8.620494555669985e-06,
      "loss": 0.1155,
      "mae_dtheta": 0.012444036081433296,
      "mae_dx": 0.0021851412020623684,
      "mae_dy": 0.0032617792021483183,
      "pose_mae_dtheta": 0.08344225585460663,
      "pose_mae_dx": 0.0293579138815403,
      "pose_mae_dy": 0.04317445680499077,
      "pose_rmse_dtheta": 0.1702246218919754,
      "pose_rmse_dx": 0.07171575725078583,
      "pose_rmse_dy": 0.09983924776315689,
      "pose_rmse_mean": 0.11392654478549957,
      "rmse_dtheta": 0.02205481193959713,
      "rmse_dx": 0.005692839156836271,
      "rmse_dy": 0.006475377362221479,
      "rmse_mean": 0.01140767615288496,
      "rotation_flip": 0.004986701998859644,
      "sparse_tokens": 32105.0,
      "step": 2999,
      "turn_loss": 0.1122913584113121,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.13937929752834047,
      "grad_norm": 0.4323940575122833,
      "learning_rate": 8.619582499657341e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.012026521377265453,
      "mae_dx": 0.002254184801131487,
      "mae_dy": 0.0026583836879581213,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4323941767215729,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.76736450195312,
      "model/head/act_norm_mean": 110.77773832070707,
      "model/head/act_norm_min": 62.26022720336914,
      "model/head/act_over_embed": 76.12749889151611,
      "model/head/grad_frac": 0.10687391459941864,
      "model/head/grad_norm": 0.04621165990829468,
      "model/head/grad_zero_frac": 0.00020210212096571922,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6961016414141414,
      "model/head/update_ratio": 0.000797530054114759,
      "model/head/weight_delta": 6.413994312286377,
      "model/head/weight_delta_rel": 0.11252045631408691,
      "model/head/weight_norm": 57.9434700012207,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41619548201560974,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41613061331847323,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41604936122894287,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2859688533486372,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09906192123889923,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04283379763364792,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5285786855381166,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013898202450945973,
      "model/modality_embedder.encoders.pose/weight_delta": 2.0988428592681885,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06857573986053467,
      "model/modality_embedder.encoders.pose/weight_norm": 30.81966781616211,
      "model/modality_embedder/grad_frac": 0.09906192123889923,
      "model/modality_embedder/grad_norm": 0.04283379763364792,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5285786855381166,
      "model/modality_embedder/update_ratio": 0.0013898202450945973,
      "model/modality_embedder/weight_delta": 2.0988428592681885,
      "model/modality_embedder/weight_delta_rel": 0.06857573986053467,
      "model/modality_embedder/weight_norm": 30.81966781616211,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.28436279296875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.567069504569506,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.005911827087402,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.19551080192108,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08614303916692734,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03724774718284607,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001345599303022027,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.404628872871399,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.051185522228479385,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.6811580657959,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.53660583496094,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.59805144700978,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.39020824432373,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.904011244971056,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08614902943372726,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0372503399848938,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012714595068246126,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.7655411958694458,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06115972623229027,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.297306060791016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.39070129394531,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.490162037037038,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.028026580810547,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.204287356656224,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10503053665161133,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04541459307074547,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015017676632851362,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.8906842470169067,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06348563730716705,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.240758895874023,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.93510437011719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.364422999839668,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.530399322509766,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.492297037401784,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1373925656080246,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05940774455666542,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020077114459127188,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.613391399383545,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05513806268572807,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.589780807495117,
      "model/normalizer/grad_frac": 0.5013229846954346,
      "model/normalizer/grad_norm": 0.21676912903785706,
      "model/normalizer/grad_zero_frac": 0.0001689885975793004,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0027745594270527363,
      "model/normalizer/weight_delta": 3.4364781379699707,
      "model/normalizer/weight_delta_rel": 0.044259849935770035,
      "model/normalizer/weight_norm": 78.12740325927734,
      "pose_mae_dtheta": 0.08543210476636887,
      "pose_mae_dx": 0.028236551210284233,
      "pose_mae_dy": 0.03116798959672451,
      "pose_rmse_dtheta": 0.22049492597579956,
      "pose_rmse_dx": 0.0742235779762268,
      "pose_rmse_dy": 0.07117816060781479,
      "pose_rmse_mean": 0.12196555733680725,
      "rmse_dtheta": 0.024940626695752144,
      "rmse_dx": 0.006714283023029566,
      "rmse_dy": 0.005636848509311676,
      "rmse_mean": 0.0124305859208107,
      "rotation_flip": 0.004378980956971645,
      "sparse_tokens": 32105.0,
      "step": 3000,
      "turn_loss": 0.09715889394283295,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.13937929752834047,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3191874325275421,
      "eval_objectnav_nopose_mae_dtheta": 0.041408468037843704,
      "eval_objectnav_nopose_mae_dx": 0.014052077196538448,
      "eval_objectnav_nopose_mae_dy": 0.00468178978189826,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3389269709587097,
      "eval_objectnav_nopose_pose_mae_dx": 0.11413151770830154,
      "eval_objectnav_nopose_pose_mae_dy": 0.053983818739652634,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.566534698009491,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2533269226551056,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12796570360660553,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3159424662590027,
      "eval_objectnav_nopose_rmse_dtheta": 0.059339843690395355,
      "eval_objectnav_nopose_rmse_dx": 0.02730298973619938,
      "eval_objectnav_nopose_rmse_dy": 0.009510278701782227,
      "eval_objectnav_nopose_rmse_mean": 0.03205103799700737,
      "eval_objectnav_nopose_rotation_flip": 0.0157491285353899,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3191874325275421,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 3000
    },
    {
      "epoch": 0.13937929752834047,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2903763949871063,
      "eval_objectnav_pose_mae_dtheta": 0.036485690623521805,
      "eval_objectnav_pose_mae_dx": 0.012210465036332607,
      "eval_objectnav_pose_mae_dy": 0.0044401464983820915,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2823161482810974,
      "eval_objectnav_pose_pose_mae_dx": 0.09894327819347382,
      "eval_objectnav_pose_pose_mae_dy": 0.04871286451816559,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4935927987098694,
      "eval_objectnav_pose_pose_rmse_dx": 0.22497963905334473,
      "eval_objectnav_pose_pose_rmse_dy": 0.11809144169092178,
      "eval_objectnav_pose_pose_rmse_mean": 0.2788879871368408,
      "eval_objectnav_pose_rmse_dtheta": 0.05437798798084259,
      "eval_objectnav_pose_rmse_dx": 0.02495058812201023,
      "eval_objectnav_pose_rmse_dy": 0.00949135422706604,
      "eval_objectnav_pose_rmse_mean": 0.029606644064188004,
      "eval_objectnav_pose_rotation_flip": 0.014677880331873894,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2903763949871063,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 3000
    },
    {
      "epoch": 0.13937929752834047,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10244344919919968,
      "eval_pointnav_mae_dtheta": 0.011708850041031837,
      "eval_pointnav_mae_dx": 0.0027816772926598787,
      "eval_pointnav_mae_dy": 0.002697916468605399,
      "eval_pointnav_pose_mae_dtheta": 0.0828271433711052,
      "eval_pointnav_pose_mae_dx": 0.030891181901097298,
      "eval_pointnav_pose_mae_dy": 0.030226347967982292,
      "eval_pointnav_pose_rmse_dtheta": 0.22311528027057648,
      "eval_pointnav_pose_rmse_dx": 0.08955398947000504,
      "eval_pointnav_pose_rmse_dy": 0.08700203150510788,
      "eval_pointnav_pose_rmse_mean": 0.1332237720489502,
      "eval_pointnav_rmse_dtheta": 0.027177441865205765,
      "eval_pointnav_rmse_dx": 0.008401413448154926,
      "eval_pointnav_rmse_dy": 0.0071066939271986485,
      "eval_pointnav_rmse_mean": 0.014228517189621925,
      "eval_pointnav_rotation_flip": 0.005282985512167215,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10244344919919968,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 3000
    },
    {
      "epoch": 0.13937929752834047,
      "eval_loss": 0.23733575890461603,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3191874325275421,
      "eval_objectnav_nopose_mae_dtheta": 0.041408468037843704,
      "eval_objectnav_nopose_mae_dx": 0.014052077196538448,
      "eval_objectnav_nopose_mae_dy": 0.00468178978189826,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3389269709587097,
      "eval_objectnav_nopose_pose_mae_dx": 0.11413151770830154,
      "eval_objectnav_nopose_pose_mae_dy": 0.053983818739652634,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.566534698009491,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2533269226551056,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12796570360660553,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3159424662590027,
      "eval_objectnav_nopose_rmse_dtheta": 0.059339843690395355,
      "eval_objectnav_nopose_rmse_dx": 0.02730298973619938,
      "eval_objectnav_nopose_rmse_dy": 0.009510278701782227,
      "eval_objectnav_nopose_rmse_mean": 0.03205103799700737,
      "eval_objectnav_nopose_rotation_flip": 0.0157491285353899,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3191874325275421,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2903763949871063,
      "eval_objectnav_pose_mae_dtheta": 0.036485690623521805,
      "eval_objectnav_pose_mae_dx": 0.012210465036332607,
      "eval_objectnav_pose_mae_dy": 0.0044401464983820915,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2823161482810974,
      "eval_objectnav_pose_pose_mae_dx": 0.09894327819347382,
      "eval_objectnav_pose_pose_mae_dy": 0.04871286451816559,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4935927987098694,
      "eval_objectnav_pose_pose_rmse_dx": 0.22497963905334473,
      "eval_objectnav_pose_pose_rmse_dy": 0.11809144169092178,
      "eval_objectnav_pose_pose_rmse_mean": 0.2788879871368408,
      "eval_objectnav_pose_rmse_dtheta": 0.05437798798084259,
      "eval_objectnav_pose_rmse_dx": 0.02495058812201023,
      "eval_objectnav_pose_rmse_dy": 0.00949135422706604,
      "eval_objectnav_pose_rmse_mean": 0.029606644064188004,
      "eval_objectnav_pose_rotation_flip": 0.014677880331873894,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2903763949871063,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10244344919919968,
      "eval_pointnav_mae_dtheta": 0.011708850041031837,
      "eval_pointnav_mae_dx": 0.0027816772926598787,
      "eval_pointnav_mae_dy": 0.002697916468605399,
      "eval_pointnav_pose_mae_dtheta": 0.0828271433711052,
      "eval_pointnav_pose_mae_dx": 0.030891181901097298,
      "eval_pointnav_pose_mae_dy": 0.030226347967982292,
      "eval_pointnav_pose_rmse_dtheta": 0.22311528027057648,
      "eval_pointnav_pose_rmse_dx": 0.08955398947000504,
      "eval_pointnav_pose_rmse_dy": 0.08700203150510788,
      "eval_pointnav_pose_rmse_mean": 0.1332237720489502,
      "eval_pointnav_rmse_dtheta": 0.027177441865205765,
      "eval_pointnav_rmse_dx": 0.008401413448154926,
      "eval_pointnav_rmse_dy": 0.0071066939271986485,
      "eval_pointnav_rmse_mean": 0.014228517189621925,
      "eval_pointnav_rotation_flip": 0.005282985512167215,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10244344919919968,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 3000
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.13942575729418324,
      "grad_norm": 1.0388190746307373,
      "learning_rate": 8.61867019052535e-06,
      "loss": 0.275,
      "mae_dtheta": 0.036904942244291306,
      "mae_dx": 0.011666174046695232,
      "mae_dy": 0.0038681761361658573,
      "pose_mae_dtheta": 0.2648904025554657,
      "pose_mae_dx": 0.100906141102314,
      "pose_mae_dy": 0.04663905128836632,
      "pose_rmse_dtheta": 0.48970848321914673,
      "pose_rmse_dx": 0.2300923466682434,
      "pose_rmse_dy": 0.10411302000284195,
      "pose_rmse_mean": 0.27463796734809875,
      "rmse_dtheta": 0.05558905005455017,
      "rmse_dx": 0.02429313026368618,
      "rmse_dy": 0.0070205992087721825,
      "rmse_mean": 0.028967594727873802,
      "rotation_flip": 0.008350730873644352,
      "sparse_tokens": 15342.0,
      "step": 3001,
      "turn_loss": 0.22192417085170746,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.13947221706002602,
      "grad_norm": 0.5605719089508057,
      "learning_rate": 8.617757628337814e-06,
      "loss": 0.1628,
      "mae_dtheta": 0.014635669998824596,
      "mae_dx": 0.0029931971803307533,
      "mae_dy": 0.004875770304352045,
      "pose_mae_dtheta": 0.11016415059566498,
      "pose_mae_dx": 0.04390142485499382,
      "pose_mae_dy": 0.055359724909067154,
      "pose_rmse_dtheta": 0.23736126720905304,
      "pose_rmse_dx": 0.12316135317087173,
      "pose_rmse_dy": 0.13126832246780396,
      "pose_rmse_mean": 0.16393032670021057,
      "rmse_dtheta": 0.026743555441498756,
      "rmse_dx": 0.008200600743293762,
      "rmse_dy": 0.009673263877630234,
      "rmse_mean": 0.014872472733259201,
      "rotation_flip": 0.004837594926357269,
      "sparse_tokens": 32041.0,
      "step": 3002,
      "turn_loss": 0.13666266202926636,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.1395186768258688,
      "grad_norm": 0.7290814518928528,
      "learning_rate": 8.61684481315854e-06,
      "loss": 0.1342,
      "mae_dtheta": 0.039506297558546066,
      "mae_dx": 0.02224620245397091,
      "mae_dy": 0.007258344441652298,
      "pose_mae_dtheta": 0.32948678731918335,
      "pose_mae_dx": 0.16313143074512482,
      "pose_mae_dy": 0.120218925178051,
      "pose_rmse_dtheta": 0.49132102727890015,
      "pose_rmse_dx": 0.3233664035797119,
      "pose_rmse_dy": 0.21571892499923706,
      "pose_rmse_mean": 0.3434687852859497,
      "rmse_dtheta": 0.05351521074771881,
      "rmse_dx": 0.03670723736286163,
      "rmse_dy": 0.011435817927122116,
      "rmse_mean": 0.03388608992099762,
      "rotation_flip": 0.019933555275201797,
      "sparse_tokens": 10646.0,
      "step": 3003,
      "turn_loss": 0.3613032400608063,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.13956513659171157,
      "grad_norm": 0.4963366985321045,
      "learning_rate": 8.61593174505137e-06,
      "loss": 0.1351,
      "mae_dtheta": 0.009155246429145336,
      "mae_dx": 0.0027277253102511168,
      "mae_dy": 0.0015610640402883291,
      "pose_mae_dtheta": 0.06770626455545425,
      "pose_mae_dx": 0.02694879099726677,
      "pose_mae_dy": 0.022632941603660583,
      "pose_rmse_dtheta": 0.15917475521564484,
      "pose_rmse_dx": 0.07759048789739609,
      "pose_rmse_dy": 0.062317460775375366,
      "pose_rmse_mean": 0.09969423711299896,
      "rmse_dtheta": 0.021205933764576912,
      "rmse_dx": 0.008331704884767532,
      "rmse_dy": 0.0036702307406812906,
      "rmse_mean": 0.011069290339946747,
      "rotation_flip": 0.004529441241174936,
      "sparse_tokens": 32121.0,
      "step": 3004,
      "turn_loss": 0.09704574197530746,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.13961159635755435,
      "grad_norm": 0.6235113143920898,
      "learning_rate": 8.615018424080151e-06,
      "loss": 0.159,
      "mae_dtheta": 0.012516108341515064,
      "mae_dx": 0.0034757230896502733,
      "mae_dy": 0.0039200675673782825,
      "pose_mae_dtheta": 0.1040957123041153,
      "pose_mae_dx": 0.030860917642712593,
      "pose_mae_dy": 0.039415035396814346,
      "pose_rmse_dtheta": 0.2802586257457733,
      "pose_rmse_dx": 0.080893874168396,
      "pose_rmse_dy": 0.11616204679012299,
      "pose_rmse_mean": 0.1591048538684845,
      "rmse_dtheta": 0.029021630063652992,
      "rmse_dx": 0.010342841036617756,
      "rmse_dy": 0.01287840586155653,
      "rmse_mean": 0.017414294183254242,
      "rotation_flip": 0.007218479178845882,
      "sparse_tokens": 32089.0,
      "step": 3005,
      "turn_loss": 0.15067091584205627,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.13965805612339713,
      "grad_norm": 0.49370062351226807,
      "learning_rate": 8.614104850308753e-06,
      "loss": 0.0788,
      "mae_dtheta": 0.06373028457164764,
      "mae_dx": 0.008169732987880707,
      "mae_dy": 0.015035985969007015,
      "pose_mae_dtheta": 0.6068365573883057,
      "pose_mae_dx": 0.07257731258869171,
      "pose_mae_dy": 0.18258202075958252,
      "pose_rmse_dtheta": 0.872181236743927,
      "pose_rmse_dx": 0.19734640419483185,
      "pose_rmse_dy": 0.4386901557445526,
      "pose_rmse_mean": 0.5027393102645874,
      "rmse_dtheta": 0.08326451480388641,
      "rmse_dx": 0.017451776191592216,
      "rmse_dy": 0.02765355072915554,
      "rmse_mean": 0.042789947241544724,
      "rotation_flip": 0.021978022530674934,
      "sparse_tokens": 2829.0,
      "step": 3006,
      "turn_loss": 0.491679847240448,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1397045158892399,
      "grad_norm": 0.4334839880466461,
      "learning_rate": 8.613191023801065e-06,
      "loss": 0.0967,
      "mae_dtheta": 0.008821899071335793,
      "mae_dx": 0.0018754039192572236,
      "mae_dy": 0.001996069448068738,
      "pose_mae_dtheta": 0.05809115990996361,
      "pose_mae_dx": 0.025732770562171936,
      "pose_mae_dy": 0.025925640016794205,
      "pose_rmse_dtheta": 0.13791659474372864,
      "pose_rmse_dx": 0.054339535534381866,
      "pose_rmse_dy": 0.05825968459248543,
      "pose_rmse_mean": 0.08350527286529541,
      "rmse_dtheta": 0.019799575209617615,
      "rmse_dx": 0.004972051363438368,
      "rmse_dy": 0.004321778658777475,
      "rmse_mean": 0.009697802364826202,
      "rotation_flip": 0.0026569245383143425,
      "sparse_tokens": 32169.0,
      "step": 3007,
      "turn_loss": 0.07291419804096222,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1397509756550827,
      "grad_norm": 0.7063853740692139,
      "learning_rate": 8.612276944620987e-06,
      "loss": 0.2026,
      "mae_dtheta": 0.012060373090207577,
      "mae_dx": 0.0026137770619243383,
      "mae_dy": 0.003849948989227414,
      "pose_mae_dtheta": 0.08975168317556381,
      "pose_mae_dx": 0.03682490065693855,
      "pose_mae_dy": 0.041799500584602356,
      "pose_rmse_dtheta": 0.18289555609226227,
      "pose_rmse_dx": 0.08744945377111435,
      "pose_rmse_dy": 0.10553468018770218,
      "pose_rmse_mean": 0.12529322504997253,
      "rmse_dtheta": 0.02238810621201992,
      "rmse_dx": 0.006518871057778597,
      "rmse_dy": 0.00814446434378624,
      "rmse_mean": 0.012350480072200298,
      "rotation_flip": 0.00848438125103712,
      "sparse_tokens": 32073.0,
      "step": 3008,
      "turn_loss": 0.10837450623512268,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1397974354209255,
      "grad_norm": 0.46592381596565247,
      "learning_rate": 8.611362612832445e-06,
      "loss": 0.1056,
      "mae_dtheta": 0.008819189853966236,
      "mae_dx": 0.0014312538551166654,
      "mae_dy": 0.001418847357854247,
      "pose_mae_dtheta": 0.05933425575494766,
      "pose_mae_dx": 0.016342250630259514,
      "pose_mae_dy": 0.01787961646914482,
      "pose_rmse_dtheta": 0.19758836925029755,
      "pose_rmse_dx": 0.04562508314847946,
      "pose_rmse_dy": 0.04636354744434357,
      "pose_rmse_mean": 0.09652566909790039,
      "rmse_dtheta": 0.024729512631893158,
      "rmse_dx": 0.0051568676717579365,
      "rmse_dy": 0.0040749721229076385,
      "rmse_mean": 0.011320451274514198,
      "rotation_flip": 0.003759398590773344,
      "sparse_tokens": 32057.0,
      "step": 3009,
      "turn_loss": 0.05819930136203766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.13984389518676826,
      "grad_norm": 0.5386632084846497,
      "learning_rate": 8.610448028499377e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.03714877367019653,
      "mae_dx": 0.01190644409507513,
      "mae_dy": 0.006833431776612997,
      "pose_mae_dtheta": 0.3295038938522339,
      "pose_mae_dx": 0.10177558660507202,
      "pose_mae_dy": 0.08352582901716232,
      "pose_rmse_dtheta": 0.5041053891181946,
      "pose_rmse_dx": 0.2144768387079239,
      "pose_rmse_dy": 0.20997697114944458,
      "pose_rmse_mean": 0.3095197379589081,
      "rmse_dtheta": 0.05335971340537071,
      "rmse_dx": 0.02345719002187252,
      "rmse_dy": 0.013850744813680649,
      "rmse_mean": 0.03022255003452301,
      "rotation_flip": 0.016051365062594414,
      "sparse_tokens": 9594.0,
      "step": 3010,
      "turn_loss": 0.37254276871681213,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.13989035495261104,
      "grad_norm": 0.4005747437477112,
      "learning_rate": 8.60953319168574e-06,
      "loss": 0.1093,
      "mae_dtheta": 0.013196046464145184,
      "mae_dx": 0.0024701659567654133,
      "mae_dy": 0.0026722890324890614,
      "pose_mae_dtheta": 0.09328755736351013,
      "pose_mae_dx": 0.030835963785648346,
      "pose_mae_dy": 0.03455414995551109,
      "pose_rmse_dtheta": 0.22175444662570953,
      "pose_rmse_dx": 0.07249166816473007,
      "pose_rmse_dy": 0.07771637290716171,
      "pose_rmse_mean": 0.12398749589920044,
      "rmse_dtheta": 0.02768632397055626,
      "rmse_dx": 0.0069036101922392845,
      "rmse_dy": 0.005382516887038946,
      "rmse_mean": 0.013324150815606117,
      "rotation_flip": 0.002968460088595748,
      "sparse_tokens": 32137.0,
      "step": 3011,
      "turn_loss": 0.09707852452993393,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.13993681471845382,
      "grad_norm": 0.41716456413269043,
      "learning_rate": 8.60861810245551e-06,
      "loss": 0.0983,
      "mae_dtheta": 0.01248010154813528,
      "mae_dx": 0.002492158440873027,
      "mae_dy": 0.0021587053779512644,
      "pose_mae_dtheta": 0.09341481328010559,
      "pose_mae_dx": 0.020604856312274933,
      "pose_mae_dy": 0.024067800492048264,
      "pose_rmse_dtheta": 0.26757800579071045,
      "pose_rmse_dx": 0.057841651141643524,
      "pose_rmse_dy": 0.05642974004149437,
      "pose_rmse_mean": 0.12728314101696014,
      "rmse_dtheta": 0.030190328136086464,
      "rmse_dx": 0.009319956414401531,
      "rmse_dy": 0.006358950864523649,
      "rmse_mean": 0.015289745293557644,
      "rotation_flip": 0.00170575687661767,
      "sparse_tokens": 32105.0,
      "step": 3012,
      "turn_loss": 0.10889304429292679,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33634.0,
      "epoch": 0.1399832744842966,
      "grad_norm": 0.42608165740966797,
      "learning_rate": 8.607702760872679e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.03786564618349075,
      "mae_dx": 0.0102398581802845,
      "mae_dy": 0.003284288104623556,
      "pose_mae_dtheta": 0.321752667427063,
      "pose_mae_dx": 0.07935989648103714,
      "pose_mae_dy": 0.03484359383583069,
      "pose_rmse_dtheta": 0.5363486409187317,
      "pose_rmse_dx": 0.18824902176856995,
      "pose_rmse_dy": 0.0971556156873703,
      "pose_rmse_mean": 0.2739177942276001,
      "rmse_dtheta": 0.055253494530916214,
      "rmse_dx": 0.02161751501262188,
      "rmse_dy": 0.0075209238566458225,
      "rmse_mean": 0.02813064306974411,
      "rotation_flip": 0.010904425755143166,
      "sparse_tokens": 25708.0,
      "step": 3013,
      "turn_loss": 0.27009057998657227,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14002973425013937,
      "grad_norm": 0.6223854422569275,
      "learning_rate": 8.606787167001258e-06,
      "loss": 0.1913,
      "mae_dtheta": 0.009586047381162643,
      "mae_dx": 0.0016245925799012184,
      "mae_dy": 0.002055646385997534,
      "pose_mae_dtheta": 0.06283415853977203,
      "pose_mae_dx": 0.021993832662701607,
      "pose_mae_dy": 0.02722802385687828,
      "pose_rmse_dtheta": 0.158272385597229,
      "pose_rmse_dx": 0.05414425581693649,
      "pose_rmse_dy": 0.06898883730173111,
      "pose_rmse_mean": 0.0938018262386322,
      "rmse_dtheta": 0.02148442156612873,
      "rmse_dx": 0.004576707724481821,
      "rmse_dy": 0.0044211214408278465,
      "rmse_mean": 0.010160750709474087,
      "rotation_flip": 0.0027755750343203545,
      "sparse_tokens": 32105.0,
      "step": 3014,
      "turn_loss": 0.07029266655445099,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14007619401598215,
      "grad_norm": 0.4180944859981537,
      "learning_rate": 8.605871320905272e-06,
      "loss": 0.088,
      "mae_dtheta": 0.01016959734261036,
      "mae_dx": 0.0015556375728920102,
      "mae_dy": 0.0018026396865025163,
      "pose_mae_dtheta": 0.07012658566236496,
      "pose_mae_dx": 0.019199086353182793,
      "pose_mae_dy": 0.0256347693502903,
      "pose_rmse_dtheta": 0.19584868848323822,
      "pose_rmse_dx": 0.05156044661998749,
      "pose_rmse_dy": 0.05692541226744652,
      "pose_rmse_mean": 0.10144485533237457,
      "rmse_dtheta": 0.024879857897758484,
      "rmse_dx": 0.005105711054056883,
      "rmse_dy": 0.0038984515704214573,
      "rmse_mean": 0.011294674128293991,
      "rotation_flip": 0.0009254974429495633,
      "sparse_tokens": 32073.0,
      "step": 3015,
      "turn_loss": 0.07125821709632874,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.14012265378182495,
      "grad_norm": 0.8348931074142456,
      "learning_rate": 8.604955222648772e-06,
      "loss": 0.1585,
      "mae_dtheta": 0.03811963275074959,
      "mae_dx": 0.01301809586584568,
      "mae_dy": 0.005623434204608202,
      "pose_mae_dtheta": 0.29375720024108887,
      "pose_mae_dx": 0.09884372353553772,
      "pose_mae_dy": 0.07187868654727936,
      "pose_rmse_dtheta": 0.5518664121627808,
      "pose_rmse_dx": 0.22158651053905487,
      "pose_rmse_dy": 0.16228513419628143,
      "pose_rmse_mean": 0.3119127154350281,
      "rmse_dtheta": 0.05924376845359802,
      "rmse_dx": 0.025771072134375572,
      "rmse_dy": 0.011600963771343231,
      "rmse_mean": 0.03220526874065399,
      "rotation_flip": 0.01149425283074379,
      "sparse_tokens": 15741.0,
      "step": 3016,
      "turn_loss": 0.30246102809906006,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 30723.0,
      "epoch": 0.14016911354766773,
      "grad_norm": 0.7028562426567078,
      "learning_rate": 8.604038872295817e-06,
      "loss": 0.2294,
      "mae_dtheta": 0.02745845727622509,
      "mae_dx": 0.012599017471075058,
      "mae_dy": 0.003535437397658825,
      "pose_mae_dtheta": 0.2171955108642578,
      "pose_mae_dx": 0.09901386499404907,
      "pose_mae_dy": 0.0450715571641922,
      "pose_rmse_dtheta": 0.4073065519332886,
      "pose_rmse_dx": 0.2361026555299759,
      "pose_rmse_dy": 0.10581408441066742,
      "pose_rmse_mean": 0.2497411072254181,
      "rmse_dtheta": 0.044725485146045685,
      "rmse_dx": 0.02550816722214222,
      "rmse_dy": 0.007336221169680357,
      "rmse_mean": 0.0258566252887249,
      "rotation_flip": 0.007413508836179972,
      "sparse_tokens": 24387.0,
      "step": 3017,
      "turn_loss": 0.23575937747955322,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.1402155733135105,
      "grad_norm": 0.6015668511390686,
      "learning_rate": 8.603122269910492e-06,
      "loss": 0.1376,
      "mae_dtheta": 0.03535450994968414,
      "mae_dx": 0.0126657048240304,
      "mae_dy": 0.005194095894694328,
      "pose_mae_dtheta": 0.27227112650871277,
      "pose_mae_dx": 0.10427675396203995,
      "pose_mae_dy": 0.05732279643416405,
      "pose_rmse_dtheta": 0.450181782245636,
      "pose_rmse_dx": 0.19565610587596893,
      "pose_rmse_dy": 0.14035721123218536,
      "pose_rmse_mean": 0.262065052986145,
      "rmse_dtheta": 0.05132991820573807,
      "rmse_dx": 0.023772431537508965,
      "rmse_dy": 0.011485536582767963,
      "rmse_mean": 0.02886263094842434,
      "rotation_flip": 0.010540184564888477,
      "sparse_tokens": 13100.0,
      "step": 3018,
      "turn_loss": 0.32220226526260376,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.14026203307935328,
      "grad_norm": 0.6898883581161499,
      "learning_rate": 8.602205415556889e-06,
      "loss": 0.1558,
      "mae_dtheta": 0.034597620368003845,
      "mae_dx": 0.01818174496293068,
      "mae_dy": 0.005309661850333214,
      "pose_mae_dtheta": 0.2906414866447449,
      "pose_mae_dx": 0.14264895021915436,
      "pose_mae_dy": 0.06200293079018593,
      "pose_rmse_dtheta": 0.500400185585022,
      "pose_rmse_dx": 0.2880592346191406,
      "pose_rmse_dy": 0.15721358358860016,
      "pose_rmse_mean": 0.3152243494987488,
      "rmse_dtheta": 0.052935872226953506,
      "rmse_dx": 0.03198124095797539,
      "rmse_dy": 0.011982272379100323,
      "rmse_mean": 0.032299794256687164,
      "rotation_flip": 0.014010507613420486,
      "sparse_tokens": 9753.0,
      "step": 3019,
      "turn_loss": 0.37934696674346924,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 34930.0,
      "epoch": 0.14030849284519606,
      "grad_norm": 0.575491189956665,
      "learning_rate": 8.60128830929913e-06,
      "loss": 0.1018,
      "mae_dtheta": 0.03307536616921425,
      "mae_dx": 0.012336366809904575,
      "mae_dy": 0.004071417730301619,
      "pose_mae_dtheta": 0.2643967866897583,
      "pose_mae_dx": 0.09911136329174042,
      "pose_mae_dy": 0.0541708804666996,
      "pose_rmse_dtheta": 0.4599456191062927,
      "pose_rmse_dx": 0.20139838755130768,
      "pose_rmse_dy": 0.12904486060142517,
      "pose_rmse_mean": 0.26346296072006226,
      "rmse_dtheta": 0.05089394003152847,
      "rmse_dx": 0.023459874093532562,
      "rmse_dy": 0.008080989122390747,
      "rmse_mean": 0.02747826837003231,
      "rotation_flip": 0.012285011820495129,
      "sparse_tokens": 28152.0,
      "step": 3020,
      "turn_loss": 0.2526401877403259,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.14035495261103884,
      "grad_norm": 0.8838410377502441,
      "learning_rate": 8.600370951201345e-06,
      "loss": 0.2739,
      "mae_dtheta": 0.03440678492188454,
      "mae_dx": 0.014221875928342342,
      "mae_dy": 0.004230313003063202,
      "pose_mae_dtheta": 0.28280603885650635,
      "pose_mae_dx": 0.11191485822200775,
      "pose_mae_dy": 0.06355194002389908,
      "pose_rmse_dtheta": 0.48656463623046875,
      "pose_rmse_dx": 0.24870562553405762,
      "pose_rmse_dy": 0.13726955652236938,
      "pose_rmse_mean": 0.2908466160297394,
      "rmse_dtheta": 0.052082475274801254,
      "rmse_dx": 0.0273117795586586,
      "rmse_dy": 0.007947725243866444,
      "rmse_mean": 0.029113993048667908,
      "rotation_flip": 0.010438413359224796,
      "sparse_tokens": 8639.0,
      "step": 3021,
      "turn_loss": 0.1994073987007141,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 26931.0,
      "epoch": 0.1404014123768816,
      "grad_norm": 0.6702287197113037,
      "learning_rate": 8.599453341327689e-06,
      "loss": 0.1322,
      "mae_dtheta": 0.03782375901937485,
      "mae_dx": 0.010479891672730446,
      "mae_dy": 0.005362007766962051,
      "pose_mae_dtheta": 0.27382269501686096,
      "pose_mae_dx": 0.08199223130941391,
      "pose_mae_dy": 0.05810070037841797,
      "pose_rmse_dtheta": 0.5173901915550232,
      "pose_rmse_dx": 0.18303151428699493,
      "pose_rmse_dy": 0.15023019909858704,
      "pose_rmse_mean": 0.2835506200790405,
      "rmse_dtheta": 0.058942653238773346,
      "rmse_dx": 0.022168496623635292,
      "rmse_dy": 0.011336068622767925,
      "rmse_mean": 0.030815739184617996,
      "rotation_flip": 0.007779349572956562,
      "sparse_tokens": 21708.0,
      "step": 3022,
      "turn_loss": 0.2789929509162903,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.1404478721427244,
      "grad_norm": 0.47518643736839294,
      "learning_rate": 8.598535479742327e-06,
      "loss": 0.0932,
      "mae_dtheta": 0.03950362652540207,
      "mae_dx": 0.020229296758770943,
      "mae_dy": 0.002474670298397541,
      "pose_mae_dtheta": 0.32793670892715454,
      "pose_mae_dx": 0.18703553080558777,
      "pose_mae_dy": 0.02464902587234974,
      "pose_rmse_dtheta": 0.5303316116333008,
      "pose_rmse_dx": 0.3593916893005371,
      "pose_rmse_dy": 0.045909520238637924,
      "pose_rmse_mean": 0.31187760829925537,
      "rmse_dtheta": 0.055990178138017654,
      "rmse_dx": 0.03517045080661774,
      "rmse_dy": 0.005171074531972408,
      "rmse_mean": 0.03211056813597679,
      "rotation_flip": 0.004201680887490511,
      "sparse_tokens": 3978.0,
      "step": 3023,
      "turn_loss": 0.3508567214012146,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.1404943319085672,
      "grad_norm": 2.225620985031128,
      "learning_rate": 8.597617366509449e-06,
      "loss": 0.3471,
      "mae_dtheta": 0.05056212097406387,
      "mae_dx": 0.036011140793561935,
      "mae_dy": 0.01475894171744585,
      "pose_mae_dtheta": 0.4022291600704193,
      "pose_mae_dx": 0.33442220091819763,
      "pose_mae_dy": 0.11549486964941025,
      "pose_rmse_dtheta": 0.6764520406723022,
      "pose_rmse_dx": 0.5875701904296875,
      "pose_rmse_dy": 0.24154438078403473,
      "pose_rmse_mean": 0.5018555521965027,
      "rmse_dtheta": 0.07331643253564835,
      "rmse_dx": 0.053940750658512115,
      "rmse_dy": 0.026034832000732422,
      "rmse_mean": 0.05109734088182449,
      "rotation_flip": 0.02304147556424141,
      "sparse_tokens": 6716.0,
      "step": 3024,
      "turn_loss": 0.7230159044265747,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14054079167440997,
      "grad_norm": 0.4241125285625458,
      "learning_rate": 8.596699001693257e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.01769467629492283,
      "mae_dx": 0.0035194805823266506,
      "mae_dy": 0.006142282858490944,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.42411261796951294,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.67755126953125,
      "model/head/act_norm_mean": 98.75388652146465,
      "model/head/act_norm_min": 46.32728958129883,
      "model/head/act_over_embed": 67.86459536600262,
      "model/head/grad_frac": 0.1101011335849762,
      "model/head/grad_norm": 0.0466952808201313,
      "model/head/grad_zero_frac": 0.00017481674149166793,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6994160353535354,
      "model/head/update_ratio": 0.0008057743543758988,
      "model/head/weight_delta": 6.443209648132324,
      "model/head/weight_delta_rel": 0.1130329817533493,
      "model/head/weight_norm": 57.9508171081543,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41606199741363525,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41600286246444773,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41594642400741577,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2858810617657286,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10672236979007721,
      "model/modality_embedder.encoders.pose/grad_norm": 0.045262303203344345,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5395575316820277,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001468514441512525,
      "model/modality_embedder.encoders.pose/weight_delta": 2.1147398948669434,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06909514218568802,
      "model/modality_embedder.encoders.pose/weight_norm": 30.82183074951172,
      "model/modality_embedder/grad_frac": 0.10672236979007721,
      "model/modality_embedder/grad_norm": 0.045262303203344345,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5395575316820277,
      "model/modality_embedder/update_ratio": 0.001468514441512525,
      "model/modality_embedder/weight_delta": 2.1147398948669434,
      "model/modality_embedder/weight_delta_rel": 0.06909514218568802,
      "model/modality_embedder/weight_norm": 30.82183074951172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.31812286376953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.489029681738014,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.00249195098877,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.454671742903443,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08349757641553879,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03541237488389015,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012792105553671718,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.4129513502120972,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05148879811167717,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.68299102783203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.52931213378906,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.51516153599487,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.44459056854248,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.159839159946532,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08548364788293839,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03625469282269478,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012373069766908884,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.777463674545288,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06157273054122925,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.30129051208496,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.2169189453125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.46835668189835,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.58114242553711,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.50209315031246,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08697343617677689,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03688653185963631,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012196142924949527,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.9033809900283813,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06391196697950363,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.244422912597656,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.95720672607422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.47355248917749,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.400920867919922,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.880082482013606,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09838222712278366,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.041725143790245056,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014099613763391972,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.6246657371520996,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05552336573600769,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.593111038208008,
      "model/normalizer/grad_frac": 0.40038394927978516,
      "model/normalizer/grad_norm": 0.16980788111686707,
      "model/normalizer/grad_zero_frac": 0.00016426164074800909,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002173355547711253,
      "model/normalizer/weight_delta": 3.4592888355255127,
      "model/normalizer/weight_delta_rel": 0.04455363750457764,
      "model/normalizer/weight_norm": 78.13166046142578,
      "pose_mae_dtheta": 0.12559857964515686,
      "pose_mae_dx": 0.048307325690984726,
      "pose_mae_dy": 0.06624940037727356,
      "pose_rmse_dtheta": 0.2718532085418701,
      "pose_rmse_dx": 0.11597637832164764,
      "pose_rmse_dy": 0.15167024731636047,
      "pose_rmse_mean": 0.1798332929611206,
      "rmse_dtheta": 0.03180628642439842,
      "rmse_dx": 0.009278658777475357,
      "rmse_dy": 0.011365381069481373,
      "rmse_mean": 0.017483443021774292,
      "rotation_flip": 0.008080808445811272,
      "sparse_tokens": 32057.0,
      "step": 3025,
      "turn_loss": 0.1711706668138504,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.14058725144025275,
      "grad_norm": 0.6592873930931091,
      "learning_rate": 8.595780385357972e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.03279471397399902,
      "mae_dx": 0.01422883477061987,
      "mae_dy": 0.0070041995495557785,
      "pose_mae_dtheta": 0.23010680079460144,
      "pose_mae_dx": 0.10707104951143265,
      "pose_mae_dy": 0.07310599088668823,
      "pose_rmse_dtheta": 0.4013617932796478,
      "pose_rmse_dx": 0.23777179419994354,
      "pose_rmse_dy": 0.1684112697839737,
      "pose_rmse_mean": 0.26918160915374756,
      "rmse_dtheta": 0.048491332679986954,
      "rmse_dx": 0.026776252314448357,
      "rmse_dy": 0.014690528623759747,
      "rmse_mean": 0.02998603694140911,
      "rotation_flip": 0.027950311079621315,
      "sparse_tokens": 11054.0,
      "step": 3026,
      "turn_loss": 0.28534889221191406,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.14063371120609552,
      "grad_norm": 0.410824716091156,
      "learning_rate": 8.594861517567837e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.00999718438833952,
      "mae_dx": 0.0023118541575968266,
      "mae_dy": 0.0017776276217773557,
      "pose_mae_dtheta": 0.06464450806379318,
      "pose_mae_dx": 0.024086447432637215,
      "pose_mae_dy": 0.021159766241908073,
      "pose_rmse_dtheta": 0.16724058985710144,
      "pose_rmse_dx": 0.05517842620611191,
      "pose_rmse_dy": 0.05410788580775261,
      "pose_rmse_mean": 0.09217563271522522,
      "rmse_dtheta": 0.024199465289711952,
      "rmse_dx": 0.006159045733511448,
      "rmse_dy": 0.0039765858091413975,
      "rmse_mean": 0.011445033363997936,
      "rotation_flip": 0.002617801073938608,
      "sparse_tokens": 32233.0,
      "step": 3027,
      "turn_loss": 0.08180342614650726,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32438.0,
      "epoch": 0.1406801709719383,
      "grad_norm": 0.5769997239112854,
      "learning_rate": 8.593942398387106e-06,
      "loss": 0.0933,
      "mae_dtheta": 0.028796646744012833,
      "mae_dx": 0.009837929159402847,
      "mae_dy": 0.00480534927919507,
      "pose_mae_dtheta": 0.22242288291454315,
      "pose_mae_dx": 0.08488738536834717,
      "pose_mae_dy": 0.07679101079702377,
      "pose_rmse_dtheta": 0.4108801484107971,
      "pose_rmse_dx": 0.20645061135292053,
      "pose_rmse_dy": 0.16446365416049957,
      "pose_rmse_mean": 0.26059815287590027,
      "rmse_dtheta": 0.046876210719347,
      "rmse_dx": 0.023000502958893776,
      "rmse_dy": 0.010056493803858757,
      "rmse_mean": 0.026644404977560043,
      "rotation_flip": 0.014728682115674019,
      "sparse_tokens": 25265.0,
      "step": 3028,
      "turn_loss": 0.23820436000823975,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.14072663073778108,
      "grad_norm": 0.39113208651542664,
      "learning_rate": 8.593023027880052e-06,
      "loss": 0.0939,
      "mae_dtheta": 0.022083386778831482,
      "mae_dx": 0.016657132655382156,
      "mae_dy": 0.006773627828806639,
      "pose_mae_dtheta": 0.14421148598194122,
      "pose_mae_dx": 0.1257701963186264,
      "pose_mae_dy": 0.0985405221581459,
      "pose_rmse_dtheta": 0.222727969288826,
      "pose_rmse_dx": 0.27063417434692383,
      "pose_rmse_dy": 0.18121770024299622,
      "pose_rmse_mean": 0.22485995292663574,
      "rmse_dtheta": 0.03403664752840996,
      "rmse_dx": 0.03146762773394585,
      "rmse_dy": 0.01005852222442627,
      "rmse_mean": 0.025187600404024124,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 2652.0,
      "step": 3029,
      "turn_loss": 0.26565343141555786,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14077309050362385,
      "grad_norm": 0.4229111969470978,
      "learning_rate": 8.592103406110972e-06,
      "loss": 0.11,
      "mae_dtheta": 0.01013454981148243,
      "mae_dx": 0.002021059161052108,
      "mae_dy": 0.0026420096401125193,
      "pose_mae_dtheta": 0.0734514370560646,
      "pose_mae_dx": 0.025971796363592148,
      "pose_mae_dy": 0.03376283869147301,
      "pose_rmse_dtheta": 0.15248653292655945,
      "pose_rmse_dx": 0.0810677707195282,
      "pose_rmse_dy": 0.0829748585820198,
      "pose_rmse_mean": 0.10550972074270248,
      "rmse_dtheta": 0.020849252119660378,
      "rmse_dx": 0.006283813621848822,
      "rmse_dy": 0.006804693955928087,
      "rmse_mean": 0.011312587186694145,
      "rotation_flip": 0.0037299515679478645,
      "sparse_tokens": 32121.0,
      "step": 3030,
      "turn_loss": 0.09585416316986084,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14081955026946663,
      "grad_norm": 0.4315911829471588,
      "learning_rate": 8.591183533144172e-06,
      "loss": 0.0918,
      "mae_dtheta": 0.008149594068527222,
      "mae_dx": 0.0016355892876163125,
      "mae_dy": 0.002263024915009737,
      "pose_mae_dtheta": 0.05115848034620285,
      "pose_mae_dx": 0.021766502410173416,
      "pose_mae_dy": 0.027748920023441315,
      "pose_rmse_dtheta": 0.0916767343878746,
      "pose_rmse_dx": 0.05291719734668732,
      "pose_rmse_dy": 0.06036866083741188,
      "pose_rmse_mean": 0.0683208629488945,
      "rmse_dtheta": 0.01519721932709217,
      "rmse_dx": 0.004749086685478687,
      "rmse_dy": 0.004694855306297541,
      "rmse_mean": 0.008213721215724945,
      "rotation_flip": 0.0038743005134165287,
      "sparse_tokens": 32073.0,
      "step": 3031,
      "turn_loss": 0.07403269410133362,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14086601003530944,
      "grad_norm": 0.5890657305717468,
      "learning_rate": 8.590263409043979e-06,
      "loss": 0.1224,
      "mae_dtheta": 0.01027347706258297,
      "mae_dx": 0.002544940682128072,
      "mae_dy": 0.0023186751641333103,
      "pose_mae_dtheta": 0.06785217672586441,
      "pose_mae_dx": 0.024878226220607758,
      "pose_mae_dy": 0.02927626296877861,
      "pose_rmse_dtheta": 0.15529775619506836,
      "pose_rmse_dx": 0.06872821599245071,
      "pose_rmse_dy": 0.06469548493623734,
      "pose_rmse_mean": 0.09624048322439194,
      "rmse_dtheta": 0.02206886000931263,
      "rmse_dx": 0.008144918829202652,
      "rmse_dy": 0.004860664252191782,
      "rmse_mean": 0.011691480875015259,
      "rotation_flip": 0.0066861677914857864,
      "sparse_tokens": 32121.0,
      "step": 3032,
      "turn_loss": 0.09221088886260986,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1409124698011522,
      "grad_norm": 0.5762360095977783,
      "learning_rate": 8.58934303387474e-06,
      "loss": 0.216,
      "mae_dtheta": 0.01090836152434349,
      "mae_dx": 0.002452592132613063,
      "mae_dy": 0.002264245878905058,
      "pose_mae_dtheta": 0.07781756669282913,
      "pose_mae_dx": 0.025618968531489372,
      "pose_mae_dy": 0.029952457174658775,
      "pose_rmse_dtheta": 0.20710670948028564,
      "pose_rmse_dx": 0.06832103431224823,
      "pose_rmse_dy": 0.08463890105485916,
      "pose_rmse_mean": 0.12002222239971161,
      "rmse_dtheta": 0.025617966428399086,
      "rmse_dx": 0.009289680980145931,
      "rmse_dy": 0.0064966753125190735,
      "rmse_mean": 0.013801440596580505,
      "rotation_flip": 0.004883546382188797,
      "sparse_tokens": 32137.0,
      "step": 3033,
      "turn_loss": 0.09404049813747406,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.140958929566995,
      "grad_norm": 0.4558026194572449,
      "learning_rate": 8.588422407700814e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.014575207605957985,
      "mae_dx": 0.002604265697300434,
      "mae_dy": 0.004112243186682463,
      "pose_mae_dtheta": 0.0963219702243805,
      "pose_mae_dx": 0.027312085032463074,
      "pose_mae_dy": 0.03912366181612015,
      "pose_rmse_dtheta": 0.2030186802148819,
      "pose_rmse_dx": 0.07038997113704681,
      "pose_rmse_dy": 0.08920980989933014,
      "pose_rmse_mean": 0.12087281793355942,
      "rmse_dtheta": 0.028471045196056366,
      "rmse_dx": 0.007529901340603828,
      "rmse_dy": 0.009669621475040913,
      "rmse_mean": 0.015223521739244461,
      "rotation_flip": 0.00833622831851244,
      "sparse_tokens": 32137.0,
      "step": 3034,
      "turn_loss": 0.14314992725849152,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.14100538933283777,
      "grad_norm": 1.927529215812683,
      "learning_rate": 8.587501530586584e-06,
      "loss": 0.2009,
      "mae_dtheta": 0.033113982528448105,
      "mae_dx": 0.012273706495761871,
      "mae_dy": 0.0019424381898716092,
      "pose_mae_dtheta": 0.22676362097263336,
      "pose_mae_dx": 0.08607063442468643,
      "pose_mae_dy": 0.020908625796437263,
      "pose_rmse_dtheta": 0.47910192608833313,
      "pose_rmse_dx": 0.20417365431785583,
      "pose_rmse_dy": 0.047908611595630646,
      "pose_rmse_mean": 0.24372807145118713,
      "rmse_dtheta": 0.05543637275695801,
      "rmse_dx": 0.023582912981510162,
      "rmse_dy": 0.005661090835928917,
      "rmse_mean": 0.028226792812347412,
      "rotation_flip": 0.01133144460618496,
      "sparse_tokens": 6384.0,
      "step": 3035,
      "turn_loss": 0.19663792848587036,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.14105184909868054,
      "grad_norm": 0.48750993609428406,
      "learning_rate": 8.586580402596448e-06,
      "loss": 0.1068,
      "mae_dtheta": 0.005764893256127834,
      "mae_dx": 0.0012857276014983654,
      "mae_dy": 0.0008679968887008727,
      "pose_mae_dtheta": 0.0401892215013504,
      "pose_mae_dx": 0.011608409695327282,
      "pose_mae_dy": 0.012892638333141804,
      "pose_rmse_dtheta": 0.14829377830028534,
      "pose_rmse_dx": 0.03528713062405586,
      "pose_rmse_dy": 0.03785139322280884,
      "pose_rmse_mean": 0.07381077110767365,
      "rmse_dtheta": 0.01891699619591236,
      "rmse_dx": 0.004753250163048506,
      "rmse_dy": 0.0025581675581634045,
      "rmse_mean": 0.008742805570363998,
      "rotation_flip": 0.0025167784187942743,
      "sparse_tokens": 32041.0,
      "step": 3036,
      "turn_loss": 0.04331449046730995,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14109830886452332,
      "grad_norm": 0.7107736468315125,
      "learning_rate": 8.585659023794818e-06,
      "loss": 0.1658,
      "mae_dtheta": 0.012822195887565613,
      "mae_dx": 0.0035536109935492277,
      "mae_dy": 0.00337587995454669,
      "pose_mae_dtheta": 0.08655252307653427,
      "pose_mae_dx": 0.043027572333812714,
      "pose_mae_dy": 0.04412442445755005,
      "pose_rmse_dtheta": 0.21287132799625397,
      "pose_rmse_dx": 0.1232924684882164,
      "pose_rmse_dy": 0.139562726020813,
      "pose_rmse_mean": 0.15857550501823425,
      "rmse_dtheta": 0.02640603668987751,
      "rmse_dx": 0.010918086394667625,
      "rmse_dy": 0.009014042094349861,
      "rmse_mean": 0.015446054749190807,
      "rotation_flip": 0.0041551245376467705,
      "sparse_tokens": 32057.0,
      "step": 3037,
      "turn_loss": 0.1288996785879135,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1411447686303661,
      "grad_norm": 0.42988085746765137,
      "learning_rate": 8.58473739424613e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.01311050821095705,
      "mae_dx": 0.0035934625193476677,
      "mae_dy": 0.003712656442075968,
      "pose_mae_dtheta": 0.09478459507226944,
      "pose_mae_dx": 0.04678461700677872,
      "pose_mae_dy": 0.04026247560977936,
      "pose_rmse_dtheta": 0.1891230046749115,
      "pose_rmse_dx": 0.11881057918071747,
      "pose_rmse_dy": 0.09438209980726242,
      "pose_rmse_mean": 0.13410523533821106,
      "rmse_dtheta": 0.025898488238453865,
      "rmse_dx": 0.009729718789458275,
      "rmse_dy": 0.008681234903633595,
      "rmse_mean": 0.014769813977181911,
      "rotation_flip": 0.004180919844657183,
      "sparse_tokens": 32105.0,
      "step": 3038,
      "turn_loss": 0.1411323994398117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14119122839620887,
      "grad_norm": 0.39312174916267395,
      "learning_rate": 8.583815514014829e-06,
      "loss": 0.104,
      "mae_dtheta": 0.00764244981110096,
      "mae_dx": 0.0016268744366243482,
      "mae_dy": 0.000750346458517015,
      "pose_mae_dtheta": 0.057835355401039124,
      "pose_mae_dx": 0.015789629891514778,
      "pose_mae_dy": 0.010891372337937355,
      "pose_rmse_dtheta": 0.2356710433959961,
      "pose_rmse_dx": 0.049310531467199326,
      "pose_rmse_dy": 0.03742315620183945,
      "pose_rmse_mean": 0.10746824741363525,
      "rmse_dtheta": 0.026069294661283493,
      "rmse_dx": 0.00515842204913497,
      "rmse_dy": 0.002378252102062106,
      "rmse_mean": 0.011201990768313408,
      "rotation_flip": 0.002998500829562545,
      "sparse_tokens": 32121.0,
      "step": 3039,
      "turn_loss": 0.051184896379709244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14123768816205165,
      "grad_norm": 0.281724750995636,
      "learning_rate": 8.582893383165387e-06,
      "loss": 0.0856,
      "mae_dtheta": 0.009321633726358414,
      "mae_dx": 0.0017977860989049077,
      "mae_dy": 0.0021597666200250387,
      "pose_mae_dtheta": 0.05865604802966118,
      "pose_mae_dx": 0.02572876773774624,
      "pose_mae_dy": 0.023340879008173943,
      "pose_rmse_dtheta": 0.1858692467212677,
      "pose_rmse_dx": 0.07070589810609818,
      "pose_rmse_dy": 0.06094666197896004,
      "pose_rmse_mean": 0.10584060847759247,
      "rmse_dtheta": 0.023852098733186722,
      "rmse_dx": 0.004997400566935539,
      "rmse_dy": 0.005408183205872774,
      "rmse_mean": 0.01141922827810049,
      "rotation_flip": 0.005610098131000996,
      "sparse_tokens": 32121.0,
      "step": 3040,
      "turn_loss": 0.07627401500940323,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.14128414792789445,
      "grad_norm": 0.6467036008834839,
      "learning_rate": 8.581971001762287e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.03158613666892052,
      "mae_dx": 0.010731840506196022,
      "mae_dy": 0.004495063330978155,
      "pose_mae_dtheta": 0.22838528454303741,
      "pose_mae_dx": 0.0835973471403122,
      "pose_mae_dy": 0.04841725155711174,
      "pose_rmse_dtheta": 0.4309302270412445,
      "pose_rmse_dx": 0.19599446654319763,
      "pose_rmse_dy": 0.13263167440891266,
      "pose_rmse_mean": 0.2531854510307312,
      "rmse_dtheta": 0.05114728957414627,
      "rmse_dx": 0.023062122985720634,
      "rmse_dy": 0.010282960720360279,
      "rmse_mean": 0.028164125978946686,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 16731.0,
      "step": 3041,
      "turn_loss": 0.24039411544799805,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.14133060769373723,
      "grad_norm": 0.5318297743797302,
      "learning_rate": 8.581048369870033e-06,
      "loss": 0.1568,
      "mae_dtheta": 0.031018320471048355,
      "mae_dx": 0.010202466510236263,
      "mae_dy": 0.005947968922555447,
      "pose_mae_dtheta": 0.26902008056640625,
      "pose_mae_dx": 0.09206554293632507,
      "pose_mae_dy": 0.061255019158124924,
      "pose_rmse_dtheta": 0.4726237952709198,
      "pose_rmse_dx": 0.21091751754283905,
      "pose_rmse_dy": 0.17051342129707336,
      "pose_rmse_mean": 0.2846848964691162,
      "rmse_dtheta": 0.04812078922986984,
      "rmse_dx": 0.02128194458782673,
      "rmse_dy": 0.013584388419985771,
      "rmse_mean": 0.027662374079227448,
      "rotation_flip": 0.009635974653065205,
      "sparse_tokens": 13687.0,
      "step": 3042,
      "turn_loss": 0.2848376929759979,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.14137706745958,
      "grad_norm": 0.5384734869003296,
      "learning_rate": 8.580125487553143e-06,
      "loss": 0.1702,
      "mae_dtheta": 0.028443770483136177,
      "mae_dx": 0.012421539053320885,
      "mae_dy": 0.004219680093228817,
      "pose_mae_dtheta": 0.22485385835170746,
      "pose_mae_dx": 0.11987948417663574,
      "pose_mae_dy": 0.07082976400852203,
      "pose_rmse_dtheta": 0.4149348735809326,
      "pose_rmse_dx": 0.248390793800354,
      "pose_rmse_dy": 0.16569370031356812,
      "pose_rmse_mean": 0.2763397991657257,
      "rmse_dtheta": 0.045261431485414505,
      "rmse_dx": 0.02533014677464962,
      "rmse_dy": 0.008067673072218895,
      "rmse_mean": 0.026219751685857773,
      "rotation_flip": 0.008650518953800201,
      "sparse_tokens": 11472.0,
      "step": 3043,
      "turn_loss": 0.23479098081588745,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.14142352722542278,
      "grad_norm": 0.6734636425971985,
      "learning_rate": 8.579202354876159e-06,
      "loss": 0.1195,
      "mae_dtheta": 0.0344650037586689,
      "mae_dx": 0.010693712159991264,
      "mae_dy": 0.003262024838477373,
      "pose_mae_dtheta": 0.25831374526023865,
      "pose_mae_dx": 0.08284559845924377,
      "pose_mae_dy": 0.03039601817727089,
      "pose_rmse_dtheta": 0.45019981265068054,
      "pose_rmse_dx": 0.17954260110855103,
      "pose_rmse_dy": 0.06269483268260956,
      "pose_rmse_mean": 0.2308124154806137,
      "rmse_dtheta": 0.04965618625283241,
      "rmse_dx": 0.021222654730081558,
      "rmse_dy": 0.006086989305913448,
      "rmse_mean": 0.02565527707338333,
      "rotation_flip": 0.00826446246355772,
      "sparse_tokens": 4023.0,
      "step": 3044,
      "turn_loss": 0.23292089998722076,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14146998699126556,
      "grad_norm": 0.39580288529396057,
      "learning_rate": 8.57827897190363e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.015404057689011097,
      "mae_dx": 0.0022425386123359203,
      "mae_dy": 0.003599377814680338,
      "pose_mae_dtheta": 0.10344535112380981,
      "pose_mae_dx": 0.0364237055182457,
      "pose_mae_dy": 0.04845492169260979,
      "pose_rmse_dtheta": 0.205842524766922,
      "pose_rmse_dx": 0.08353399485349655,
      "pose_rmse_dy": 0.10776862502098083,
      "pose_rmse_mean": 0.13238172233104706,
      "rmse_dtheta": 0.02742062322795391,
      "rmse_dx": 0.005608069244772196,
      "rmse_dy": 0.007043796591460705,
      "rmse_mean": 0.013357496820390224,
      "rotation_flip": 0.009119607508182526,
      "sparse_tokens": 32057.0,
      "step": 3045,
      "turn_loss": 0.1361371874809265,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.14151644675710834,
      "grad_norm": 0.467879056930542,
      "learning_rate": 8.577355338700133e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.011495404876768589,
      "mae_dx": 0.0016246166778728366,
      "mae_dy": 0.002556799678131938,
      "pose_mae_dtheta": 0.07437599450349808,
      "pose_mae_dx": 0.024330271407961845,
      "pose_mae_dy": 0.0335996113717556,
      "pose_rmse_dtheta": 0.1469929814338684,
      "pose_rmse_dx": 0.056122079491615295,
      "pose_rmse_dy": 0.08690774440765381,
      "pose_rmse_mean": 0.09667426347732544,
      "rmse_dtheta": 0.022733766585588455,
      "rmse_dx": 0.004209713079035282,
      "rmse_dy": 0.005605398677289486,
      "rmse_mean": 0.01084962673485279,
      "rotation_flip": 0.005762581713497639,
      "sparse_tokens": 32137.0,
      "step": 3046,
      "turn_loss": 0.10125302523374557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.14156290652295112,
      "grad_norm": 0.4537470042705536,
      "learning_rate": 8.576431455330258e-06,
      "loss": 0.1109,
      "mae_dtheta": 0.03556176275014877,
      "mae_dx": 0.011690708808600903,
      "mae_dy": 0.007461338769644499,
      "pose_mae_dtheta": 0.3051873743534088,
      "pose_mae_dx": 0.08601250499486923,
      "pose_mae_dy": 0.08097916096448898,
      "pose_rmse_dtheta": 0.5095848441123962,
      "pose_rmse_dx": 0.1806853711605072,
      "pose_rmse_dy": 0.194950133562088,
      "pose_rmse_mean": 0.2950734496116638,
      "rmse_dtheta": 0.051698993891477585,
      "rmse_dx": 0.023377476260066032,
      "rmse_dy": 0.017115393653512,
      "rmse_mean": 0.03073062002658844,
      "rotation_flip": 0.013953488320112228,
      "sparse_tokens": 11228.0,
      "step": 3047,
      "turn_loss": 0.2971095144748688,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1416093662887939,
      "grad_norm": 0.33160969614982605,
      "learning_rate": 8.575507321858612e-06,
      "loss": 0.0917,
      "mae_dtheta": 0.008549202233552933,
      "mae_dx": 0.0015299272490665317,
      "mae_dy": 0.002267736941576004,
      "pose_mae_dtheta": 0.05677304044365883,
      "pose_mae_dx": 0.023094335570931435,
      "pose_mae_dy": 0.02620852366089821,
      "pose_rmse_dtheta": 0.14324428141117096,
      "pose_rmse_dx": 0.06253296881914139,
      "pose_rmse_dy": 0.07526259869337082,
      "pose_rmse_mean": 0.09367995709180832,
      "rmse_dtheta": 0.01976899430155754,
      "rmse_dx": 0.004382024519145489,
      "rmse_dy": 0.005225098226219416,
      "rmse_mean": 0.009792039170861244,
      "rotation_flip": 0.0034246575087308884,
      "sparse_tokens": 32089.0,
      "step": 3048,
      "turn_loss": 0.06740324199199677,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.1416558260546367,
      "grad_norm": 0.43910813331604004,
      "learning_rate": 8.574582938349818e-06,
      "loss": 0.1111,
      "mae_dtheta": 0.010541104711592197,
      "mae_dx": 0.003367346478626132,
      "mae_dy": 0.00345604564063251,
      "pose_mae_dtheta": 0.07620161026716232,
      "pose_mae_dx": 0.044699061661958694,
      "pose_mae_dy": 0.035078439861536026,
      "pose_rmse_dtheta": 0.2101505547761917,
      "pose_rmse_dx": 0.13869154453277588,
      "pose_rmse_dy": 0.10035158693790436,
      "pose_rmse_mean": 0.14973121881484985,
      "rmse_dtheta": 0.024737676605582237,
      "rmse_dx": 0.01052144169807434,
      "rmse_dy": 0.009132287465035915,
      "rmse_mean": 0.014797136187553406,
      "rotation_flip": 0.004957858007401228,
      "sparse_tokens": 32041.0,
      "step": 3049,
      "turn_loss": 0.13303323090076447,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.14170228582047947,
      "grad_norm": 0.503667414188385,
      "learning_rate": 8.573658304868522e-06,
      "loss": 0.1351,
      "mae_dtheta": 0.03956963121891022,
      "mae_dx": 0.01049022562801838,
      "mae_dy": 0.006258938927203417,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5036675333976746,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.5003662109375,
      "model/head/act_norm_mean": 103.39513629415761,
      "model/head/act_norm_min": 74.29086303710938,
      "model/head/act_over_embed": 71.0541056618622,
      "model/head/grad_frac": 0.10669903457164764,
      "model/head/grad_norm": 0.053740840405225754,
      "model/head/grad_zero_frac": 0.00019258396059740335,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6867994225543478,
      "model/head/update_ratio": 0.0009272570023313165,
      "model/head/weight_delta": 6.469341278076172,
      "model/head/weight_delta_rel": 0.11349140852689743,
      "model/head/weight_norm": 57.956790924072266,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4161722958087921,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4161722958087921,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4161722958087921,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.285997497946222,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0997927337884903,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05026236176490784,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016306695761159062,
      "model/modality_embedder.encoders.pose/weight_delta": 2.128967523574829,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06956000626087189,
      "model/modality_embedder.encoders.pose/weight_norm": 30.823143005371094,
      "model/modality_embedder/grad_frac": 0.0997927337884903,
      "model/modality_embedder/grad_norm": 0.05026236176490784,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0016306695761159062,
      "model/modality_embedder/weight_delta": 2.128967523574829,
      "model/modality_embedder/weight_delta_rel": 0.06956000626087189,
      "model/modality_embedder/weight_norm": 30.823143005371094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.80621337890625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.85065670289855,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.1732177734375,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.703185217450478,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1115848645567894,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05620167404413223,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020300711039453745,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.4220305681228638,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05181965231895447,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.68458366394043,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 82.29020690917969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.705227743271223,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.798324584960938,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.29045443701471,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10019970685243607,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05046733841300011,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017221443122252822,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.789518117904663,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06199030578136444,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.304941177368164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.13319396972656,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.376838552449964,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.107605934143066,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.439201034949303,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09655372053384781,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0486309751868248,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001607729820534587,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.9162335395812988,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06434353440999985,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.248226165771484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.908447265625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.34499007936508,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.290493965148926,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.791733190370273,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1056627631187439,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05321890488266945,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001798185403458774,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.6353384256362915,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0558881051838398,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.59589385986328,
      "model/normalizer/grad_frac": 0.43743565678596497,
      "model/normalizer/grad_norm": 0.2203221321105957,
      "model/normalizer/grad_zero_frac": 0.0002115311799570918,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002819747431203723,
      "model/normalizer/weight_delta": 3.482081651687622,
      "model/normalizer/weight_delta_rel": 0.044847194105386734,
      "model/normalizer/weight_norm": 78.13541412353516,
      "pose_mae_dtheta": 0.31516963243484497,
      "pose_mae_dx": 0.08877405524253845,
      "pose_mae_dy": 0.0819428563117981,
      "pose_rmse_dtheta": 0.5167832374572754,
      "pose_rmse_dx": 0.18184134364128113,
      "pose_rmse_dy": 0.23767319321632385,
      "pose_rmse_mean": 0.31209927797317505,
      "rmse_dtheta": 0.05488862469792366,
      "rmse_dx": 0.02029936946928501,
      "rmse_dy": 0.012943907640874386,
      "rmse_mean": 0.029377302154898643,
      "rotation_flip": 0.01986755058169365,
      "sparse_tokens": 11889.0,
      "step": 3050,
      "turn_loss": 0.3180526793003082,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.14174874558632225,
      "grad_norm": 0.5744801163673401,
      "learning_rate": 8.572733421479382e-06,
      "loss": 0.1571,
      "mae_dtheta": 0.015228544361889362,
      "mae_dx": 0.004374055657535791,
      "mae_dy": 0.003355194814503193,
      "pose_mae_dtheta": 0.11028598994016647,
      "pose_mae_dx": 0.048441968858242035,
      "pose_mae_dy": 0.04618258401751518,
      "pose_rmse_dtheta": 0.25833335518836975,
      "pose_rmse_dx": 0.13318279385566711,
      "pose_rmse_dy": 0.097376748919487,
      "pose_rmse_mean": 0.16296431422233582,
      "rmse_dtheta": 0.029122833162546158,
      "rmse_dx": 0.013103255070745945,
      "rmse_dy": 0.006392843089997768,
      "rmse_mean": 0.01620631106197834,
      "rotation_flip": 0.006540977396070957,
      "sparse_tokens": 32089.0,
      "step": 3051,
      "turn_loss": 0.1554923951625824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.14179520535216503,
      "grad_norm": 0.4347984492778778,
      "learning_rate": 8.571808288247077e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.0328521728515625,
      "mae_dx": 0.015736695379018784,
      "mae_dy": 0.003930139355361462,
      "pose_mae_dtheta": 0.2699449062347412,
      "pose_mae_dx": 0.12956960499286652,
      "pose_mae_dy": 0.06838670372962952,
      "pose_rmse_dtheta": 0.4660419821739197,
      "pose_rmse_dx": 0.28545260429382324,
      "pose_rmse_dy": 0.15621636807918549,
      "pose_rmse_mean": 0.3025703430175781,
      "rmse_dtheta": 0.04809360206127167,
      "rmse_dx": 0.02916952595114708,
      "rmse_dy": 0.007336670067161322,
      "rmse_mean": 0.0281999334692955,
      "rotation_flip": 0.007092198356986046,
      "sparse_tokens": 9054.0,
      "step": 3052,
      "turn_loss": 0.2874649465084076,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1418416651180078,
      "grad_norm": 0.3741014301776886,
      "learning_rate": 8.570882905236302e-06,
      "loss": 0.0858,
      "mae_dtheta": 0.013510857708752155,
      "mae_dx": 0.0023730644024908543,
      "mae_dy": 0.003477278631180525,
      "pose_mae_dtheta": 0.0929798111319542,
      "pose_mae_dx": 0.03433859720826149,
      "pose_mae_dy": 0.04133608564734459,
      "pose_rmse_dtheta": 0.20797882974147797,
      "pose_rmse_dx": 0.09240581840276718,
      "pose_rmse_dy": 0.08937688916921616,
      "pose_rmse_mean": 0.12992051243782043,
      "rmse_dtheta": 0.025925427675247192,
      "rmse_dx": 0.007283767685294151,
      "rmse_dy": 0.007438233587890863,
      "rmse_mean": 0.013549144379794598,
      "rotation_flip": 0.004410143475979567,
      "sparse_tokens": 32057.0,
      "step": 3053,
      "turn_loss": 0.11564721912145615,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.14188812488385058,
      "grad_norm": 0.47468411922454834,
      "learning_rate": 8.569957272511766e-06,
      "loss": 0.081,
      "mae_dtheta": 0.010702060535550117,
      "mae_dx": 0.001962987007573247,
      "mae_dy": 0.002044934080913663,
      "pose_mae_dtheta": 0.07358938455581665,
      "pose_mae_dx": 0.024106459692120552,
      "pose_mae_dy": 0.02650679461658001,
      "pose_rmse_dtheta": 0.19643788039684296,
      "pose_rmse_dx": 0.05757235735654831,
      "pose_rmse_dy": 0.06188640743494034,
      "pose_rmse_mean": 0.10529887676239014,
      "rmse_dtheta": 0.02537972666323185,
      "rmse_dx": 0.005638947244733572,
      "rmse_dy": 0.004275175742805004,
      "rmse_mean": 0.011764617636799812,
      "rotation_flip": 0.0019762846641242504,
      "sparse_tokens": 32137.0,
      "step": 3054,
      "turn_loss": 0.08226236701011658,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14193458464969336,
      "grad_norm": 0.8684443235397339,
      "learning_rate": 8.569031390138202e-06,
      "loss": 0.1684,
      "mae_dtheta": 0.00797826424241066,
      "mae_dx": 0.001164932968094945,
      "mae_dy": 0.0007543597603216767,
      "pose_mae_dtheta": 0.05552755296230316,
      "pose_mae_dx": 0.011036397889256477,
      "pose_mae_dy": 0.012821204029023647,
      "pose_rmse_dtheta": 0.20959879457950592,
      "pose_rmse_dx": 0.03355574607849121,
      "pose_rmse_dy": 0.03487272933125496,
      "pose_rmse_mean": 0.09267576038837433,
      "rmse_dtheta": 0.02614842914044857,
      "rmse_dx": 0.00423585856333375,
      "rmse_dy": 0.001762737170793116,
      "rmse_mean": 0.010715674608945847,
      "rotation_flip": 0.0026972354389727116,
      "sparse_tokens": 32105.0,
      "step": 3055,
      "turn_loss": 0.04436708614230156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.14198104441553613,
      "grad_norm": 0.5699188113212585,
      "learning_rate": 8.56810525818036e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.014419636689126492,
      "mae_dx": 0.004340893588960171,
      "mae_dy": 0.00503601785749197,
      "pose_mae_dtheta": 0.10919995605945587,
      "pose_mae_dx": 0.042932163923978806,
      "pose_mae_dy": 0.03951386362314224,
      "pose_rmse_dtheta": 0.2740076780319214,
      "pose_rmse_dx": 0.11244414001703262,
      "pose_rmse_dy": 0.1015833243727684,
      "pose_rmse_mean": 0.16267839074134827,
      "rmse_dtheta": 0.03242567554116249,
      "rmse_dx": 0.01174418069422245,
      "rmse_dy": 0.013747267425060272,
      "rmse_mean": 0.01930570974946022,
      "rotation_flip": 0.0037950663827359676,
      "sparse_tokens": 32185.0,
      "step": 3056,
      "turn_loss": 0.15959356725215912,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.14202750418137894,
      "grad_norm": 0.5335838198661804,
      "learning_rate": 8.567178876703002e-06,
      "loss": 0.1472,
      "mae_dtheta": 0.007615281734615564,
      "mae_dx": 0.001707158051431179,
      "mae_dy": 0.000626994064077735,
      "pose_mae_dtheta": 0.0525754950940609,
      "pose_mae_dx": 0.017108965665102005,
      "pose_mae_dy": 0.011277837678790092,
      "pose_rmse_dtheta": 0.20692281424999237,
      "pose_rmse_dx": 0.05081716179847717,
      "pose_rmse_dy": 0.030758943408727646,
      "pose_rmse_mean": 0.09616630524396896,
      "rmse_dtheta": 0.026623185724020004,
      "rmse_dx": 0.005663641262799501,
      "rmse_dy": 0.001512333401478827,
      "rmse_mean": 0.011266387067735195,
      "rotation_flip": 0.0006369426846504211,
      "sparse_tokens": 32137.0,
      "step": 3057,
      "turn_loss": 0.05256778001785278,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.14207396394722172,
      "grad_norm": 0.4611784815788269,
      "learning_rate": 8.56625224577091e-06,
      "loss": 0.1502,
      "mae_dtheta": 0.008495869114995003,
      "mae_dx": 0.001443019020371139,
      "mae_dy": 0.0008729887777008116,
      "pose_mae_dtheta": 0.062260787934064865,
      "pose_mae_dx": 0.013457734137773514,
      "pose_mae_dy": 0.01171137299388647,
      "pose_rmse_dtheta": 0.24099378287792206,
      "pose_rmse_dx": 0.042714133858680725,
      "pose_rmse_dy": 0.034825149923563004,
      "pose_rmse_mean": 0.1061776876449585,
      "rmse_dtheta": 0.027304265648126602,
      "rmse_dx": 0.004879697225987911,
      "rmse_dy": 0.002580023603513837,
      "rmse_mean": 0.011587996035814285,
      "rotation_flip": 0.005379959475249052,
      "sparse_tokens": 32089.0,
      "step": 3058,
      "turn_loss": 0.054551929235458374,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.1421204237130645,
      "grad_norm": 0.42163577675819397,
      "learning_rate": 8.565325365448883e-06,
      "loss": 0.1405,
      "mae_dtheta": 0.03921470046043396,
      "mae_dx": 0.012110251933336258,
      "mae_dy": 0.0037497153971344233,
      "pose_mae_dtheta": 0.28731468319892883,
      "pose_mae_dx": 0.06446197628974915,
      "pose_mae_dy": 0.0294172540307045,
      "pose_rmse_dtheta": 0.5147870182991028,
      "pose_rmse_dx": 0.13699261844158173,
      "pose_rmse_dy": 0.07119661569595337,
      "pose_rmse_mean": 0.24099209904670715,
      "rmse_dtheta": 0.059479720890522,
      "rmse_dx": 0.022646985948085785,
      "rmse_dy": 0.007737901993095875,
      "rmse_mean": 0.02995487116277218,
      "rotation_flip": 0.017241379246115685,
      "sparse_tokens": 4998.0,
      "step": 3059,
      "turn_loss": 0.27443060278892517,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14216688347890727,
      "grad_norm": 0.6230629682540894,
      "learning_rate": 8.56439823580174e-06,
      "loss": 0.0789,
      "mae_dtheta": 0.008457357063889503,
      "mae_dx": 0.0023265606723725796,
      "mae_dy": 0.001828307518735528,
      "pose_mae_dtheta": 0.05480727553367615,
      "pose_mae_dx": 0.02376825176179409,
      "pose_mae_dy": 0.022089961916208267,
      "pose_rmse_dtheta": 0.12165277451276779,
      "pose_rmse_dx": 0.06415864080190659,
      "pose_rmse_dy": 0.056597448885440826,
      "pose_rmse_mean": 0.08080296218395233,
      "rmse_dtheta": 0.01857423596084118,
      "rmse_dx": 0.007233485113829374,
      "rmse_dy": 0.004659181460738182,
      "rmse_mean": 0.010155634954571724,
      "rotation_flip": 0.0036281179636716843,
      "sparse_tokens": 32121.0,
      "step": 3060,
      "turn_loss": 0.06733939796686172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.14221334324475005,
      "grad_norm": 0.7663016319274902,
      "learning_rate": 8.563470856894316e-06,
      "loss": 0.1873,
      "mae_dtheta": 0.01905100606381893,
      "mae_dx": 0.01253106351941824,
      "mae_dy": 0.009158343076705933,
      "pose_mae_dtheta": 0.14863325655460358,
      "pose_mae_dx": 0.11828447133302689,
      "pose_mae_dy": 0.09250984340906143,
      "pose_rmse_dtheta": 0.25218069553375244,
      "pose_rmse_dx": 0.24613253772258759,
      "pose_rmse_dy": 0.19540414214134216,
      "pose_rmse_mean": 0.23123912513256073,
      "rmse_dtheta": 0.02933581918478012,
      "rmse_dx": 0.025194814428687096,
      "rmse_dy": 0.016649099066853523,
      "rmse_mean": 0.023726578801870346,
      "rotation_flip": 0.0,
      "sparse_tokens": 2648.0,
      "step": 3061,
      "turn_loss": 0.30909404158592224,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.14225980301059282,
      "grad_norm": 0.47871965169906616,
      "learning_rate": 8.562543228791462e-06,
      "loss": 0.137,
      "mae_dtheta": 0.040582653135061264,
      "mae_dx": 0.012083485722541809,
      "mae_dy": 0.008453373797237873,
      "pose_mae_dtheta": 0.33339083194732666,
      "pose_mae_dx": 0.08766891807317734,
      "pose_mae_dy": 0.1139310747385025,
      "pose_rmse_dtheta": 0.593621015548706,
      "pose_rmse_dx": 0.19012561440467834,
      "pose_rmse_dy": 0.25450751185417175,
      "pose_rmse_mean": 0.34608471393585205,
      "rmse_dtheta": 0.0635637417435646,
      "rmse_dx": 0.02410213090479374,
      "rmse_dy": 0.018347278237342834,
      "rmse_mean": 0.03533771634101868,
      "rotation_flip": 0.011538461782038212,
      "sparse_tokens": 9526.0,
      "step": 3062,
      "turn_loss": 0.43962493538856506,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.1423062627764356,
      "grad_norm": 0.3527377247810364,
      "learning_rate": 8.561615351558047e-06,
      "loss": 0.1018,
      "mae_dtheta": 0.032969631254673004,
      "mae_dx": 0.008035998791456223,
      "mae_dy": 0.004176306538283825,
      "pose_mae_dtheta": 0.23917192220687866,
      "pose_mae_dx": 0.05504133179783821,
      "pose_mae_dy": 0.044574178755283356,
      "pose_rmse_dtheta": 0.432187557220459,
      "pose_rmse_dx": 0.12168176472187042,
      "pose_rmse_dy": 0.09824874252080917,
      "pose_rmse_mean": 0.21737268567085266,
      "rmse_dtheta": 0.05183445289731026,
      "rmse_dx": 0.01756715029478073,
      "rmse_dy": 0.009148981422185898,
      "rmse_mean": 0.026183530688285828,
      "rotation_flip": 0.014428412541747093,
      "sparse_tokens": 15441.0,
      "step": 3063,
      "turn_loss": 0.23243138194084167,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.14235272254227838,
      "grad_norm": 0.43552088737487793,
      "learning_rate": 8.56068722525896e-06,
      "loss": 0.0892,
      "mae_dtheta": 0.029169030487537384,
      "mae_dx": 0.008338101208209991,
      "mae_dy": 0.003988923039287329,
      "pose_mae_dtheta": 0.2198171317577362,
      "pose_mae_dx": 0.05721477046608925,
      "pose_mae_dy": 0.04376010596752167,
      "pose_rmse_dtheta": 0.3650152087211609,
      "pose_rmse_dx": 0.1614987850189209,
      "pose_rmse_dy": 0.11015886068344116,
      "pose_rmse_mean": 0.21222428977489471,
      "rmse_dtheta": 0.04518195614218712,
      "rmse_dx": 0.02012518048286438,
      "rmse_dy": 0.007752806413918734,
      "rmse_mean": 0.02435331605374813,
      "rotation_flip": 0.009845288470387459,
      "sparse_tokens": 11996.0,
      "step": 3064,
      "turn_loss": 0.2680010497570038,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14239918230812118,
      "grad_norm": 0.37627431750297546,
      "learning_rate": 8.559758849959103e-06,
      "loss": 0.0897,
      "mae_dtheta": 0.010011335834860802,
      "mae_dx": 0.0021810182370245457,
      "mae_dy": 0.002589297015219927,
      "pose_mae_dtheta": 0.06538724154233932,
      "pose_mae_dx": 0.025810249149799347,
      "pose_mae_dy": 0.03143555670976639,
      "pose_rmse_dtheta": 0.1422969549894333,
      "pose_rmse_dx": 0.0598287433385849,
      "pose_rmse_dy": 0.06441856920719147,
      "pose_rmse_mean": 0.08884809911251068,
      "rmse_dtheta": 0.019122980535030365,
      "rmse_dx": 0.006566439755260944,
      "rmse_dy": 0.004551971796900034,
      "rmse_mean": 0.01008046418428421,
      "rotation_flip": 0.0031928480602800846,
      "sparse_tokens": 32121.0,
      "step": 3065,
      "turn_loss": 0.09016668796539307,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.14244564207396396,
      "grad_norm": 0.5684844255447388,
      "learning_rate": 8.5588302257234e-06,
      "loss": 0.1715,
      "mae_dtheta": 0.04296325519680977,
      "mae_dx": 0.007961085066199303,
      "mae_dy": 0.006030845455825329,
      "pose_mae_dtheta": 0.3824591338634491,
      "pose_mae_dx": 0.06931845098733902,
      "pose_mae_dy": 0.07858829200267792,
      "pose_rmse_dtheta": 0.6443694829940796,
      "pose_rmse_dx": 0.17917269468307495,
      "pose_rmse_dy": 0.1828443855047226,
      "pose_rmse_mean": 0.33546218276023865,
      "rmse_dtheta": 0.06105027720332146,
      "rmse_dx": 0.018997838720679283,
      "rmse_dy": 0.01219958160072565,
      "rmse_mean": 0.030749231576919556,
      "rotation_flip": 0.00937500037252903,
      "sparse_tokens": 5700.0,
      "step": 3066,
      "turn_loss": 0.2587607204914093,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14249210183980673,
      "grad_norm": 0.33521464467048645,
      "learning_rate": 8.557901352616788e-06,
      "loss": 0.0953,
      "mae_dtheta": 0.006704216822981834,
      "mae_dx": 0.0013857422163709998,
      "mae_dy": 0.0016533457674086094,
      "pose_mae_dtheta": 0.04572826996445656,
      "pose_mae_dx": 0.01620779186487198,
      "pose_mae_dy": 0.018917763605713844,
      "pose_rmse_dtheta": 0.09981025010347366,
      "pose_rmse_dx": 0.04314426705241203,
      "pose_rmse_dy": 0.04350396245718002,
      "pose_rmse_mean": 0.06215282529592514,
      "rmse_dtheta": 0.015118836425244808,
      "rmse_dx": 0.00396414240822196,
      "rmse_dy": 0.003935300745069981,
      "rmse_mean": 0.0076727597042918205,
      "rotation_flip": 0.005099439062178135,
      "sparse_tokens": 32073.0,
      "step": 3067,
      "turn_loss": 0.056994013488292694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1425385616056495,
      "grad_norm": 0.42741701006889343,
      "learning_rate": 8.556972230704226e-06,
      "loss": 0.1069,
      "mae_dtheta": 0.009302674792706966,
      "mae_dx": 0.001797578763216734,
      "mae_dy": 0.001890717539936304,
      "pose_mae_dtheta": 0.06495628505945206,
      "pose_mae_dx": 0.022495759651064873,
      "pose_mae_dy": 0.025460219010710716,
      "pose_rmse_dtheta": 0.12281592935323715,
      "pose_rmse_dx": 0.06720714271068573,
      "pose_rmse_dy": 0.05221690982580185,
      "pose_rmse_mean": 0.08074666559696198,
      "rmse_dtheta": 0.017620930448174477,
      "rmse_dx": 0.00636433158069849,
      "rmse_dy": 0.0036199132446199656,
      "rmse_mean": 0.00920172594487667,
      "rotation_flip": 0.003565768711268902,
      "sparse_tokens": 32089.0,
      "step": 3068,
      "turn_loss": 0.07543555647134781,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.1425850213714923,
      "grad_norm": 0.5550752878189087,
      "learning_rate": 8.556042860050686e-06,
      "loss": 0.1632,
      "mae_dtheta": 0.03240569308400154,
      "mae_dx": 0.010538016445934772,
      "mae_dy": 0.005123598966747522,
      "pose_mae_dtheta": 0.2541232109069824,
      "pose_mae_dx": 0.07718557119369507,
      "pose_mae_dy": 0.04791218414902687,
      "pose_rmse_dtheta": 0.4321874678134918,
      "pose_rmse_dx": 0.19503052532672882,
      "pose_rmse_dy": 0.1249057799577713,
      "pose_rmse_mean": 0.2507079243659973,
      "rmse_dtheta": 0.048834193497896194,
      "rmse_dx": 0.02246592566370964,
      "rmse_dy": 0.014267189428210258,
      "rmse_mean": 0.028522437438368797,
      "rotation_flip": 0.023545706644654274,
      "sparse_tokens": 10416.0,
      "step": 3069,
      "turn_loss": 0.26910391449928284,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14263148113733506,
      "grad_norm": 0.4323291480541229,
      "learning_rate": 8.555113240721162e-06,
      "loss": 0.1381,
      "mae_dtheta": 0.011367768049240112,
      "mae_dx": 0.0018548710504546762,
      "mae_dy": 0.0018896748078987002,
      "pose_mae_dtheta": 0.07834497094154358,
      "pose_mae_dx": 0.019324427470564842,
      "pose_mae_dy": 0.02266726829111576,
      "pose_rmse_dtheta": 0.22308620810508728,
      "pose_rmse_dx": 0.07139583677053452,
      "pose_rmse_dy": 0.05692783370614052,
      "pose_rmse_mean": 0.1171366274356842,
      "rmse_dtheta": 0.02663555182516575,
      "rmse_dx": 0.006281109061092138,
      "rmse_dy": 0.005394699051976204,
      "rmse_mean": 0.0127704543992877,
      "rotation_flip": 0.005808757618069649,
      "sparse_tokens": 32105.0,
      "step": 3070,
      "turn_loss": 0.08465611189603806,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.14267794090317784,
      "grad_norm": 0.6816645860671997,
      "learning_rate": 8.554183372780659e-06,
      "loss": 0.1303,
      "mae_dtheta": 0.03781838342547417,
      "mae_dx": 0.012559076771140099,
      "mae_dy": 0.00816059485077858,
      "pose_mae_dtheta": 0.28498998284339905,
      "pose_mae_dx": 0.09656035900115967,
      "pose_mae_dy": 0.07641417533159256,
      "pose_rmse_dtheta": 0.4923515021800995,
      "pose_rmse_dx": 0.2221727967262268,
      "pose_rmse_dy": 0.18421559035778046,
      "pose_rmse_mean": 0.2995799779891968,
      "rmse_dtheta": 0.05675139278173447,
      "rmse_dx": 0.024477960541844368,
      "rmse_dy": 0.017520133405923843,
      "rmse_mean": 0.03291649743914604,
      "rotation_flip": 0.019178081303834915,
      "sparse_tokens": 12991.0,
      "step": 3071,
      "turn_loss": 0.29425734281539917,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 17535.0,
      "epoch": 0.14272440066902062,
      "grad_norm": 0.47673794627189636,
      "learning_rate": 8.553253256294206e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.03008703701198101,
      "mae_dx": 0.01090382132679224,
      "mae_dy": 0.005760932341217995,
      "pose_mae_dtheta": 0.23418506979942322,
      "pose_mae_dx": 0.0791102722287178,
      "pose_mae_dy": 0.0689406618475914,
      "pose_rmse_dtheta": 0.40684157609939575,
      "pose_rmse_dx": 0.18446137011051178,
      "pose_rmse_dy": 0.16392840445041656,
      "pose_rmse_mean": 0.25174379348754883,
      "rmse_dtheta": 0.045466359704732895,
      "rmse_dx": 0.023057902231812477,
      "rmse_dy": 0.012238419614732265,
      "rmse_mean": 0.026920896023511887,
      "rotation_flip": 0.015665795654058456,
      "sparse_tokens": 14368.0,
      "step": 3072,
      "turn_loss": 0.2492259293794632,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1427708604348634,
      "grad_norm": 0.6104522347450256,
      "learning_rate": 8.552322891326846e-06,
      "loss": 0.0839,
      "mae_dtheta": 0.010975955985486507,
      "mae_dx": 0.0020831290166825056,
      "mae_dy": 0.003012322587892413,
      "pose_mae_dtheta": 0.08060690760612488,
      "pose_mae_dx": 0.029189353808760643,
      "pose_mae_dy": 0.039789408445358276,
      "pose_rmse_dtheta": 0.1823946088552475,
      "pose_rmse_dx": 0.07457411289215088,
      "pose_rmse_dy": 0.09528403729200363,
      "pose_rmse_mean": 0.1174175962805748,
      "rmse_dtheta": 0.022240567952394485,
      "rmse_dx": 0.00596093013882637,
      "rmse_dy": 0.00659723998978734,
      "rmse_mean": 0.011599579825997353,
      "rotation_flip": 0.0022143488749861717,
      "sparse_tokens": 32057.0,
      "step": 3073,
      "turn_loss": 0.09231135994195938,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1428173202007062,
      "grad_norm": 0.36985304951667786,
      "learning_rate": 8.551392277943637e-06,
      "loss": 0.0983,
      "mae_dtheta": 0.00641250517219305,
      "mae_dx": 0.0014525970909744501,
      "mae_dy": 0.0005179474828764796,
      "pose_mae_dtheta": 0.04362611845135689,
      "pose_mae_dx": 0.013965576887130737,
      "pose_mae_dy": 0.008408702909946442,
      "pose_rmse_dtheta": 0.17051109671592712,
      "pose_rmse_dx": 0.0354619063436985,
      "pose_rmse_dy": 0.02529233507812023,
      "pose_rmse_mean": 0.07708844542503357,
      "rmse_dtheta": 0.022142328321933746,
      "rmse_dx": 0.004330603871494532,
      "rmse_dy": 0.001229973160661757,
      "rmse_mean": 0.009234301745891571,
      "rotation_flip": 0.004605263005942106,
      "sparse_tokens": 32137.0,
      "step": 3074,
      "turn_loss": 0.04309534654021263,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14286377996654898,
      "grad_norm": 0.5172056555747986,
      "learning_rate": 8.550461416209663e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.013860093429684639,
      "mae_dx": 0.002454344416037202,
      "mae_dy": 0.004049383103847504,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5172057747840881,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.43643188476562,
      "model/head/act_norm_mean": 110.08276120580808,
      "model/head/act_norm_min": 42.91623306274414,
      "model/head/act_over_embed": 75.64990411167926,
      "model/head/grad_frac": 0.11249211430549622,
      "model/head/grad_norm": 0.05818157270550728,
      "model/head/grad_zero_frac": 0.00018370035104453564,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6927675189393939,
      "model/head/update_ratio": 0.0010037950705736876,
      "model/head/weight_delta": 6.493029594421387,
      "model/head/weight_delta_rel": 0.11390697211027145,
      "model/head/weight_norm": 57.961605072021484,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4163389205932617,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4162620578646125,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4161953926086426,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2860591832713474,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07028825581073761,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03635349124670029,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5402361266816144,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011793251615017653,
      "model/modality_embedder.encoders.pose/weight_delta": 2.1385393142700195,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06987274438142776,
      "model/modality_embedder.encoders.pose/weight_norm": 30.825674057006836,
      "model/modality_embedder/grad_frac": 0.07028825581073761,
      "model/modality_embedder/grad_norm": 0.03635349124670029,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5402361266816144,
      "model/modality_embedder/update_ratio": 0.0011793251615017653,
      "model/modality_embedder/weight_delta": 2.1385393142700195,
      "model/modality_embedder/weight_delta_rel": 0.06987274438142776,
      "model/modality_embedder/weight_norm": 30.825674057006836,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.7408676147461,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.585700757575758,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.94524097442627,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.208314373415515,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0807407945394516,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04175960645079613,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015083006583154202,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.4306622743606567,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0521341972053051,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.686527252197266,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.03612518310547,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.660579004329005,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.434043884277344,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.94698076775304,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08761298656463623,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.045313943177461624,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001546142273582518,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.8000950813293457,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.062356699258089066,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.3077449798584,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.71017456054688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.659196127946128,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.933661460876465,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.32044916645104,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10246802121400833,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.052997052669525146,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017518802778795362,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.9281506538391113,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06474369019269943,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.25152587890625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.3375015258789,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.55451589305756,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.745363235473633,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.622930653298823,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.13148456811904907,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06800457835197449,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002297649858519435,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.6452620029449463,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.056227248162031174,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.597450256347656,
      "model/normalizer/grad_frac": 0.48943188786506653,
      "model/normalizer/grad_norm": 0.2531369924545288,
      "model/normalizer/grad_zero_frac": 0.00018789641035255045,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0032395890448242426,
      "model/normalizer/weight_delta": 3.5032401084899902,
      "model/normalizer/weight_delta_rel": 0.04511970281600952,
      "model/normalizer/weight_norm": 78.13861083984375,
      "pose_mae_dtheta": 0.10627470910549164,
      "pose_mae_dx": 0.03261660784482956,
      "pose_mae_dy": 0.04400094971060753,
      "pose_rmse_dtheta": 0.30064690113067627,
      "pose_rmse_dx": 0.09749728441238403,
      "pose_rmse_dy": 0.1361456960439682,
      "pose_rmse_mean": 0.17809663712978363,
      "rmse_dtheta": 0.031134307384490967,
      "rmse_dx": 0.008176883682608604,
      "rmse_dy": 0.013454781845211983,
      "rmse_mean": 0.0175886582583189,
      "rotation_flip": 0.006460875738412142,
      "sparse_tokens": 32105.0,
      "step": 3075,
      "turn_loss": 0.12753011286258698,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.14291023973239175,
      "grad_norm": 0.6941608190536499,
      "learning_rate": 8.549530306190015e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.042135514318943024,
      "mae_dx": 0.01190999522805214,
      "mae_dy": 0.006483593489974737,
      "pose_mae_dtheta": 0.34541749954223633,
      "pose_mae_dx": 0.09869085997343063,
      "pose_mae_dy": 0.08449399471282959,
      "pose_rmse_dtheta": 0.6217755675315857,
      "pose_rmse_dx": 0.21017174422740936,
      "pose_rmse_dy": 0.22133196890354156,
      "pose_rmse_mean": 0.3510931134223938,
      "rmse_dtheta": 0.06336013972759247,
      "rmse_dx": 0.024556158110499382,
      "rmse_dy": 0.013037867844104767,
      "rmse_mean": 0.03365138918161392,
      "rotation_flip": 0.017486339434981346,
      "sparse_tokens": 16131.0,
      "step": 3076,
      "turn_loss": 0.30390554666519165,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 20453.0,
      "epoch": 0.14295669949823453,
      "grad_norm": 0.537212073802948,
      "learning_rate": 8.548598947949807e-06,
      "loss": 0.1628,
      "mae_dtheta": 0.02695929817855358,
      "mae_dx": 0.011218403466045856,
      "mae_dy": 0.003180571598932147,
      "pose_mae_dtheta": 0.18648047745227814,
      "pose_mae_dx": 0.10014602541923523,
      "pose_mae_dy": 0.03511248156428337,
      "pose_rmse_dtheta": 0.3397611081600189,
      "pose_rmse_dx": 0.21454961597919464,
      "pose_rmse_dy": 0.07523006945848465,
      "pose_rmse_mean": 0.20984694361686707,
      "rmse_dtheta": 0.04232557490468025,
      "rmse_dx": 0.022572511807084084,
      "rmse_dy": 0.006046300753951073,
      "rmse_mean": 0.023648131638765335,
      "rotation_flip": 0.013319672085344791,
      "sparse_tokens": 16551.0,
      "step": 3077,
      "turn_loss": 0.24593256413936615,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.1430031592640773,
      "grad_norm": 0.4288732707500458,
      "learning_rate": 8.547667341554172e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.025930849835276604,
      "mae_dx": 0.008424483239650726,
      "mae_dy": 0.002163373865187168,
      "pose_mae_dtheta": 0.1717246174812317,
      "pose_mae_dx": 0.05914395675063133,
      "pose_mae_dy": 0.025373956188559532,
      "pose_rmse_dtheta": 0.3363528549671173,
      "pose_rmse_dx": 0.16330431401729584,
      "pose_rmse_dy": 0.06130768358707428,
      "pose_rmse_mean": 0.18698827922344208,
      "rmse_dtheta": 0.045228295028209686,
      "rmse_dx": 0.01910359039902687,
      "rmse_dy": 0.004605439025908709,
      "rmse_mean": 0.02297911047935486,
      "rotation_flip": 0.010590014979243279,
      "sparse_tokens": 14372.0,
      "step": 3078,
      "turn_loss": 0.18760202825069427,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.14304961902992008,
      "grad_norm": 0.6144295930862427,
      "learning_rate": 8.546735487068253e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.01073163840919733,
      "mae_dx": 0.00262633734382689,
      "mae_dy": 0.0027212644927203655,
      "pose_mae_dtheta": 0.07534485310316086,
      "pose_mae_dx": 0.02704945206642151,
      "pose_mae_dy": 0.030668824911117554,
      "pose_rmse_dtheta": 0.15274900197982788,
      "pose_rmse_dx": 0.06798096746206284,
      "pose_rmse_dy": 0.08149922639131546,
      "pose_rmse_mean": 0.10074307024478912,
      "rmse_dtheta": 0.01954122819006443,
      "rmse_dx": 0.007755384314805269,
      "rmse_dy": 0.006960565224289894,
      "rmse_mean": 0.011419059708714485,
      "rotation_flip": 0.006384676788002253,
      "sparse_tokens": 32137.0,
      "step": 3079,
      "turn_loss": 0.10188859701156616,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14309607879576286,
      "grad_norm": 0.6384148001670837,
      "learning_rate": 8.545803384557219e-06,
      "loss": 0.1339,
      "mae_dtheta": 0.01633976586163044,
      "mae_dx": 0.0025683718267828226,
      "mae_dy": 0.004584002308547497,
      "pose_mae_dtheta": 0.12033934891223907,
      "pose_mae_dx": 0.04512948915362358,
      "pose_mae_dy": 0.05484336242079735,
      "pose_rmse_dtheta": 0.23171181976795197,
      "pose_rmse_dx": 0.1060972660779953,
      "pose_rmse_dy": 0.11142782866954803,
      "pose_rmse_mean": 0.1497456431388855,
      "rmse_dtheta": 0.02786584198474884,
      "rmse_dx": 0.0068848999217152596,
      "rmse_dy": 0.00846385583281517,
      "rmse_mean": 0.01440486591309309,
      "rotation_flip": 0.007495315279811621,
      "sparse_tokens": 32073.0,
      "step": 3080,
      "turn_loss": 0.14742067456245422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14314253856160564,
      "grad_norm": 0.48362043499946594,
      "learning_rate": 8.54487103408625e-06,
      "loss": 0.1083,
      "mae_dtheta": 0.012095572426915169,
      "mae_dx": 0.0018487672787159681,
      "mae_dy": 0.002440043957903981,
      "pose_mae_dtheta": 0.08744004368782043,
      "pose_mae_dx": 0.02677638828754425,
      "pose_mae_dy": 0.032404348254203796,
      "pose_rmse_dtheta": 0.20939530432224274,
      "pose_rmse_dx": 0.06379739940166473,
      "pose_rmse_dy": 0.07371225208044052,
      "pose_rmse_mean": 0.1156349927186966,
      "rmse_dtheta": 0.024725643917918205,
      "rmse_dx": 0.005676610395312309,
      "rmse_dy": 0.004916725214570761,
      "rmse_mean": 0.01177299302071333,
      "rotation_flip": 0.0023210830986499786,
      "sparse_tokens": 32105.0,
      "step": 3081,
      "turn_loss": 0.08769656717777252,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10409.0,
      "epoch": 0.14318899832744844,
      "grad_norm": 0.5785138010978699,
      "learning_rate": 8.543938435720548e-06,
      "loss": 0.1918,
      "mae_dtheta": 0.03570413589477539,
      "mae_dx": 0.01382081676274538,
      "mae_dy": 0.0036667492240667343,
      "pose_mae_dtheta": 0.26051148772239685,
      "pose_mae_dx": 0.10097342729568481,
      "pose_mae_dy": 0.0496121309697628,
      "pose_rmse_dtheta": 0.476179301738739,
      "pose_rmse_dx": 0.2191433310508728,
      "pose_rmse_dy": 0.11677837371826172,
      "pose_rmse_mean": 0.2707003355026245,
      "rmse_dtheta": 0.055281490087509155,
      "rmse_dx": 0.02615651674568653,
      "rmse_dy": 0.006881683133542538,
      "rmse_mean": 0.02943989634513855,
      "rotation_flip": 0.004115226212888956,
      "sparse_tokens": 8617.0,
      "step": 3082,
      "turn_loss": 0.319131076335907,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 27903.0,
      "epoch": 0.14323545809329122,
      "grad_norm": 1.0448691844940186,
      "learning_rate": 8.54300558952533e-06,
      "loss": 0.2978,
      "mae_dtheta": 0.030931847169995308,
      "mae_dx": 0.013002919964492321,
      "mae_dy": 0.006270925048738718,
      "pose_mae_dtheta": 0.23400571942329407,
      "pose_mae_dx": 0.0995073914527893,
      "pose_mae_dy": 0.07413337379693985,
      "pose_rmse_dtheta": 0.42050033807754517,
      "pose_rmse_dx": 0.23064997792243958,
      "pose_rmse_dy": 0.18280546367168427,
      "pose_rmse_mean": 0.27798527479171753,
      "rmse_dtheta": 0.048873670399188995,
      "rmse_dx": 0.026017984375357628,
      "rmse_dy": 0.013524356298148632,
      "rmse_mean": 0.029472004622220993,
      "rotation_flip": 0.011636927723884583,
      "sparse_tokens": 22208.0,
      "step": 3083,
      "turn_loss": 0.33001282811164856,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.143281917859134,
      "grad_norm": 0.6378117799758911,
      "learning_rate": 8.542072495565829e-06,
      "loss": 0.1358,
      "mae_dtheta": 0.009759978391230106,
      "mae_dx": 0.0012941762106493115,
      "mae_dy": 0.0012792509514838457,
      "pose_mae_dtheta": 0.0755101889371872,
      "pose_mae_dx": 0.016286682337522507,
      "pose_mae_dy": 0.01939501240849495,
      "pose_rmse_dtheta": 0.23902608454227448,
      "pose_rmse_dx": 0.043112270534038544,
      "pose_rmse_dy": 0.04914390295743942,
      "pose_rmse_mean": 0.11042742431163788,
      "rmse_dtheta": 0.026498965919017792,
      "rmse_dx": 0.004234060645103455,
      "rmse_dy": 0.002938465913757682,
      "rmse_mean": 0.011223830282688141,
      "rotation_flip": 0.0018639329355210066,
      "sparse_tokens": 32105.0,
      "step": 3084,
      "turn_loss": 0.06157230585813522,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14332837762497677,
      "grad_norm": 0.6997966170310974,
      "learning_rate": 8.541139153907296e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.012861995957791805,
      "mae_dx": 0.003120227949693799,
      "mae_dy": 0.003801322542130947,
      "pose_mae_dtheta": 0.09542293101549149,
      "pose_mae_dx": 0.03182969242334366,
      "pose_mae_dy": 0.0428704172372818,
      "pose_rmse_dtheta": 0.2359311729669571,
      "pose_rmse_dx": 0.08399640768766403,
      "pose_rmse_dy": 0.12608776986598969,
      "pose_rmse_mean": 0.14867179095745087,
      "rmse_dtheta": 0.027716627344489098,
      "rmse_dx": 0.009588467888534069,
      "rmse_dy": 0.009566434659063816,
      "rmse_mean": 0.015623843297362328,
      "rotation_flip": 0.005076142027974129,
      "sparse_tokens": 32073.0,
      "step": 3085,
      "turn_loss": 0.12406853586435318,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11703.0,
      "epoch": 0.14337483739081955,
      "grad_norm": 0.8701841235160828,
      "learning_rate": 8.540205564615002e-06,
      "loss": 0.162,
      "mae_dtheta": 0.032616131007671356,
      "mae_dx": 0.009221455082297325,
      "mae_dy": 0.007707498501986265,
      "pose_mae_dtheta": 0.3004368245601654,
      "pose_mae_dx": 0.07533571869134903,
      "pose_mae_dy": 0.11991983652114868,
      "pose_rmse_dtheta": 0.5030468106269836,
      "pose_rmse_dx": 0.17502330243587494,
      "pose_rmse_dy": 0.2680491507053375,
      "pose_rmse_mean": 0.31537312269210815,
      "rmse_dtheta": 0.05017730966210365,
      "rmse_dx": 0.021780317649245262,
      "rmse_dy": 0.01689787395298481,
      "rmse_mean": 0.02961849980056286,
      "rotation_flip": 0.014209591783583164,
      "sparse_tokens": 9822.0,
      "step": 3086,
      "turn_loss": 0.26130780577659607,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.14342129715666233,
      "grad_norm": 0.4382472336292267,
      "learning_rate": 8.539271727754234e-06,
      "loss": 0.0912,
      "mae_dtheta": 0.009990149177610874,
      "mae_dx": 0.002039879560470581,
      "mae_dy": 0.0024252901785075665,
      "pose_mae_dtheta": 0.06562217324972153,
      "pose_mae_dx": 0.022962700575590134,
      "pose_mae_dy": 0.025890517979860306,
      "pose_rmse_dtheta": 0.16252803802490234,
      "pose_rmse_dx": 0.07431214302778244,
      "pose_rmse_dy": 0.0604020394384861,
      "pose_rmse_mean": 0.09908074140548706,
      "rmse_dtheta": 0.021694449707865715,
      "rmse_dx": 0.006218752358108759,
      "rmse_dy": 0.006263433024287224,
      "rmse_mean": 0.01139221154153347,
      "rotation_flip": 0.006904955487698317,
      "sparse_tokens": 32089.0,
      "step": 3087,
      "turn_loss": 0.07925675809383392,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32987.0,
      "epoch": 0.1434677569225051,
      "grad_norm": 0.6279478073120117,
      "learning_rate": 8.538337643390293e-06,
      "loss": 0.1418,
      "mae_dtheta": 0.04183055832982063,
      "mae_dx": 0.018139183521270752,
      "mae_dy": 0.005550190340727568,
      "pose_mae_dtheta": 0.36775413155555725,
      "pose_mae_dx": 0.1533493846654892,
      "pose_mae_dy": 0.06955946981906891,
      "pose_rmse_dtheta": 0.6087425351142883,
      "pose_rmse_dx": 0.30172011256217957,
      "pose_rmse_dy": 0.16371965408325195,
      "pose_rmse_mean": 0.3580607771873474,
      "rmse_dtheta": 0.060112785547971725,
      "rmse_dx": 0.031022178009152412,
      "rmse_dy": 0.011391626670956612,
      "rmse_mean": 0.034175530076026917,
      "rotation_flip": 0.01697045937180519,
      "sparse_tokens": 26757.0,
      "step": 3088,
      "turn_loss": 0.34890323877334595,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14351421668834788,
      "grad_norm": 0.6196234226226807,
      "learning_rate": 8.537403311588502e-06,
      "loss": 0.1222,
      "mae_dtheta": 0.010913966223597527,
      "mae_dx": 0.001954394392669201,
      "mae_dy": 0.002440987154841423,
      "pose_mae_dtheta": 0.07822012156248093,
      "pose_mae_dx": 0.02587040886282921,
      "pose_mae_dy": 0.03084183670580387,
      "pose_rmse_dtheta": 0.1949947029352188,
      "pose_rmse_dx": 0.07200152426958084,
      "pose_rmse_dy": 0.0679023414850235,
      "pose_rmse_mean": 0.11163286864757538,
      "rmse_dtheta": 0.024363860487937927,
      "rmse_dx": 0.0062284329906105995,
      "rmse_dy": 0.005344370845705271,
      "rmse_mean": 0.011978888884186745,
      "rotation_flip": 0.003364171599969268,
      "sparse_tokens": 32073.0,
      "step": 3089,
      "turn_loss": 0.0831172987818718,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14356067645419068,
      "grad_norm": 0.646841287612915,
      "learning_rate": 8.536468732414198e-06,
      "loss": 0.103,
      "mae_dtheta": 0.010866493918001652,
      "mae_dx": 0.0027971279341727495,
      "mae_dy": 0.0033159328158944845,
      "pose_mae_dtheta": 0.0712323859333992,
      "pose_mae_dx": 0.030034270137548447,
      "pose_mae_dy": 0.0343216173350811,
      "pose_rmse_dtheta": 0.14528417587280273,
      "pose_rmse_dx": 0.08006292581558228,
      "pose_rmse_dy": 0.07493094354867935,
      "pose_rmse_mean": 0.10009267926216125,
      "rmse_dtheta": 0.02135317027568817,
      "rmse_dx": 0.008229004219174385,
      "rmse_dy": 0.008102865889668465,
      "rmse_mean": 0.012561680749058723,
      "rotation_flip": 0.003859513672068715,
      "sparse_tokens": 32057.0,
      "step": 3090,
      "turn_loss": 0.11359740793704987,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.14360713622003346,
      "grad_norm": 0.5676364898681641,
      "learning_rate": 8.535533905932739e-06,
      "loss": 0.109,
      "mae_dtheta": 0.030778083950281143,
      "mae_dx": 0.008646469563245773,
      "mae_dy": 0.005318440031260252,
      "pose_mae_dtheta": 0.24864520132541656,
      "pose_mae_dx": 0.07854530960321426,
      "pose_mae_dy": 0.05408365651965141,
      "pose_rmse_dtheta": 0.4697040915489197,
      "pose_rmse_dx": 0.20960278809070587,
      "pose_rmse_dy": 0.10900060087442398,
      "pose_rmse_mean": 0.2627691626548767,
      "rmse_dtheta": 0.04899933934211731,
      "rmse_dx": 0.020783554762601852,
      "rmse_dy": 0.01078092958778143,
      "rmse_mean": 0.026854610070586205,
      "rotation_flip": 0.009493670426309109,
      "sparse_tokens": 11309.0,
      "step": 3091,
      "turn_loss": 0.2228887975215912,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.14365359598587624,
      "grad_norm": 0.4819246232509613,
      "learning_rate": 8.534598832209495e-06,
      "loss": 0.1556,
      "mae_dtheta": 0.02571314014494419,
      "mae_dx": 0.00890799704939127,
      "mae_dy": 0.0058539253659546375,
      "pose_mae_dtheta": 0.19439342617988586,
      "pose_mae_dx": 0.06098323315382004,
      "pose_mae_dy": 0.07552360743284225,
      "pose_rmse_dtheta": 0.4169034957885742,
      "pose_rmse_dx": 0.1827339082956314,
      "pose_rmse_dy": 0.187665194272995,
      "pose_rmse_mean": 0.2624342143535614,
      "rmse_dtheta": 0.04417233169078827,
      "rmse_dx": 0.02220156416296959,
      "rmse_dy": 0.011380748823285103,
      "rmse_mean": 0.02591821551322937,
      "rotation_flip": 0.005319148767739534,
      "sparse_tokens": 9802.0,
      "step": 3092,
      "turn_loss": 0.23744741082191467,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.143700055751719,
      "grad_norm": 0.5042788982391357,
      "learning_rate": 8.533663511309858e-06,
      "loss": 0.0732,
      "mae_dtheta": 0.004972525406628847,
      "mae_dx": 0.0029620868153870106,
      "mae_dy": 0.0006121161859482527,
      "pose_mae_dtheta": 0.03831136226654053,
      "pose_mae_dx": 0.02416534349322319,
      "pose_mae_dy": 0.01172975730150938,
      "pose_rmse_dtheta": 0.1384054273366928,
      "pose_rmse_dx": 0.10399568825960159,
      "pose_rmse_dy": 0.023146843537688255,
      "pose_rmse_mean": 0.0885159894824028,
      "rmse_dtheta": 0.0164499394595623,
      "rmse_dx": 0.010897407308220863,
      "rmse_dy": 0.0011540752602741122,
      "rmse_mean": 0.009500473737716675,
      "rotation_flip": 0.0013280212879180908,
      "sparse_tokens": 32073.0,
      "step": 3093,
      "turn_loss": 0.0454278290271759,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.1437465155175618,
      "grad_norm": 0.5265291929244995,
      "learning_rate": 8.532727943299235e-06,
      "loss": 0.1455,
      "mae_dtheta": 0.03281733766198158,
      "mae_dx": 0.014601755887269974,
      "mae_dy": 0.005867673084139824,
      "pose_mae_dtheta": 0.2732259929180145,
      "pose_mae_dx": 0.12014709413051605,
      "pose_mae_dy": 0.06994946300983429,
      "pose_rmse_dtheta": 0.47778552770614624,
      "pose_rmse_dx": 0.24381305277347565,
      "pose_rmse_dy": 0.16020740568637848,
      "pose_rmse_mean": 0.2939353287220001,
      "rmse_dtheta": 0.05087227374315262,
      "rmse_dx": 0.02756306901574135,
      "rmse_dy": 0.010926234535872936,
      "rmse_mean": 0.02978719398379326,
      "rotation_flip": 0.00975081231445074,
      "sparse_tokens": 17592.0,
      "step": 3094,
      "turn_loss": 0.29152899980545044,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.14379297528340457,
      "grad_norm": 0.7595917582511902,
      "learning_rate": 8.53179212824305e-06,
      "loss": 0.2497,
      "mae_dtheta": 0.02129768766462803,
      "mae_dx": 0.011170612648129463,
      "mae_dy": 0.005548443179577589,
      "pose_mae_dtheta": 0.15310972929000854,
      "pose_mae_dx": 0.09396223723888397,
      "pose_mae_dy": 0.0725417360663414,
      "pose_rmse_dtheta": 0.2847098708152771,
      "pose_rmse_dx": 0.24956892430782318,
      "pose_rmse_dy": 0.16494105756282806,
      "pose_rmse_mean": 0.23307329416275024,
      "rmse_dtheta": 0.03564515337347984,
      "rmse_dx": 0.025654463097453117,
      "rmse_dy": 0.011615860275924206,
      "rmse_mean": 0.024305157363414764,
      "rotation_flip": 0.007704160176217556,
      "sparse_tokens": 13040.0,
      "step": 3095,
      "turn_loss": 0.20905910432338715,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.14383943504924734,
      "grad_norm": 0.6747861504554749,
      "learning_rate": 8.530856066206746e-06,
      "loss": 0.1845,
      "mae_dtheta": 0.03274354338645935,
      "mae_dx": 0.014070899225771427,
      "mae_dy": 0.004985308274626732,
      "pose_mae_dtheta": 0.2601848244667053,
      "pose_mae_dx": 0.10279520601034164,
      "pose_mae_dy": 0.04981762170791626,
      "pose_rmse_dtheta": 0.4511394202709198,
      "pose_rmse_dx": 0.2152405083179474,
      "pose_rmse_dy": 0.12612371146678925,
      "pose_rmse_mean": 0.2641679048538208,
      "rmse_dtheta": 0.04969802871346474,
      "rmse_dx": 0.026223011314868927,
      "rmse_dy": 0.012200554832816124,
      "rmse_mean": 0.02937386743724346,
      "rotation_flip": 0.01669195666909218,
      "sparse_tokens": 10742.0,
      "step": 3096,
      "turn_loss": 0.2875628173351288,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.14388589481509012,
      "grad_norm": 0.6663732528686523,
      "learning_rate": 8.529919757255783e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.02906934916973114,
      "mae_dx": 0.007571185007691383,
      "mae_dy": 0.005013877525925636,
      "pose_mae_dtheta": 0.21647119522094727,
      "pose_mae_dx": 0.07121503353118896,
      "pose_mae_dy": 0.06613127887248993,
      "pose_rmse_dtheta": 0.4223695993423462,
      "pose_rmse_dx": 0.17281143367290497,
      "pose_rmse_dy": 0.1491488218307495,
      "pose_rmse_mean": 0.24810996651649475,
      "rmse_dtheta": 0.04852919280529022,
      "rmse_dx": 0.018750933930277824,
      "rmse_dy": 0.009775419719517231,
      "rmse_mean": 0.025685183703899384,
      "rotation_flip": 0.008121827617287636,
      "sparse_tokens": 20387.0,
      "step": 3097,
      "turn_loss": 0.2218053638935089,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14393235458093293,
      "grad_norm": 0.5502665638923645,
      "learning_rate": 8.528983201455635e-06,
      "loss": 0.1588,
      "mae_dtheta": 0.009893997572362423,
      "mae_dx": 0.0018286834238097072,
      "mae_dy": 0.0030159023590385914,
      "pose_mae_dtheta": 0.06946294009685516,
      "pose_mae_dx": 0.028356198221445084,
      "pose_mae_dy": 0.03610182926058769,
      "pose_rmse_dtheta": 0.13690392673015594,
      "pose_rmse_dx": 0.07054834067821503,
      "pose_rmse_dy": 0.07313483208417892,
      "pose_rmse_mean": 0.09352903813123703,
      "rmse_dtheta": 0.01911059394478798,
      "rmse_dx": 0.005632408428937197,
      "rmse_dy": 0.006225164979696274,
      "rmse_mean": 0.010322722606360912,
      "rotation_flip": 0.0026345502119511366,
      "sparse_tokens": 32057.0,
      "step": 3098,
      "turn_loss": 0.08613792806863785,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.1439788143467757,
      "grad_norm": 0.5570530891418457,
      "learning_rate": 8.5280463988718e-06,
      "loss": 0.1347,
      "mae_dtheta": 0.01241037342697382,
      "mae_dx": 0.002384945284575224,
      "mae_dy": 0.0026491631288081408,
      "pose_mae_dtheta": 0.0868971049785614,
      "pose_mae_dx": 0.02986803464591503,
      "pose_mae_dy": 0.03070736490190029,
      "pose_rmse_dtheta": 0.22194986045360565,
      "pose_rmse_dx": 0.0688784196972847,
      "pose_rmse_dy": 0.0758633241057396,
      "pose_rmse_mean": 0.12223054468631744,
      "rmse_dtheta": 0.02767239883542061,
      "rmse_dx": 0.006927612703293562,
      "rmse_dy": 0.0063551911152899265,
      "rmse_mean": 0.01365173514932394,
      "rotation_flip": 0.0033978933934122324,
      "sparse_tokens": 32185.0,
      "step": 3099,
      "turn_loss": 0.11237209290266037,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.14402527411261848,
      "grad_norm": 0.7137897610664368,
      "learning_rate": 8.527109349569787e-06,
      "loss": 0.2187,
      "mae_dtheta": 0.04998135194182396,
      "mae_dx": 0.009944136254489422,
      "mae_dy": 0.005219038110226393,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7137898802757263,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 135.8323974609375,
      "model/head/act_norm_mean": 99.11890900440706,
      "model/head/act_norm_min": 65.83171081542969,
      "model/head/act_over_embed": 68.11544223367497,
      "model/head/grad_frac": 0.1184271052479744,
      "model/head/grad_norm": 0.08453206717967987,
      "model/head/grad_zero_frac": 0.00021193754218984395,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6959134615384616,
      "model/head/update_ratio": 0.001458256272599101,
      "model/head/weight_delta": 6.521605014801025,
      "model/head/weight_delta_rel": 0.11440826952457428,
      "model/head/weight_norm": 57.96791076660156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41630616784095764,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41630616784095764,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41630616784095764,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28608949606005585,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07581238448619843,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05411411076784134,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017554142978042364,
      "model/modality_embedder.encoders.pose/weight_delta": 2.1447348594665527,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07007516920566559,
      "model/modality_embedder.encoders.pose/weight_norm": 30.826974868774414,
      "model/modality_embedder/grad_frac": 0.07581238448619843,
      "model/modality_embedder/grad_norm": 0.05411411076784134,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0017554142978042364,
      "model/modality_embedder/weight_delta": 2.1447348594665527,
      "model/modality_embedder/weight_delta_rel": 0.07007516920566559,
      "model/modality_embedder/weight_norm": 30.826974868774414,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.08209228515625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.407312016687015,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.287901878356934,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.398514598427564,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0819699838757515,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05850934609770775,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003580939373932779,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0021131618414074183,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.440101981163025,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.052478186786174774,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.68805694580078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.3141860961914,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.268046334452585,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.872326850891113,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.990019279917707,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08895020186901093,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06349175423383713,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002166147343814373,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.8124513626098633,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06278473138809204,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.3109130859375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.41268157958984,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.920359877391128,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.229045867919922,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.125504615828184,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08964824676513672,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06399001181125641,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002115037525072694,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.9414973258972168,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0651918426156044,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.25478744506836,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.76359558105469,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.91290509259259,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.022295951843262,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.49480034221684,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10312457382678986,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07360927760601044,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002486690180376172,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.6577073335647583,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05665256828069687,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.60130500793457,
      "model/normalizer/grad_frac": 0.41322392225265503,
      "model/normalizer/grad_norm": 0.2949550449848175,
      "model/normalizer/grad_zero_frac": 0.00023516594956163317,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003774570068344474,
      "model/normalizer/weight_delta": 3.527611255645752,
      "model/normalizer/weight_delta_rel": 0.045433592051267624,
      "model/normalizer/weight_norm": 78.14268493652344,
      "pose_mae_dtheta": 0.4227865934371948,
      "pose_mae_dx": 0.06526286900043488,
      "pose_mae_dy": 0.06966722756624222,
      "pose_rmse_dtheta": 0.677084743976593,
      "pose_rmse_dx": 0.1336507946252823,
      "pose_rmse_dy": 0.13917112350463867,
      "pose_rmse_mean": 0.3166355490684509,
      "rmse_dtheta": 0.06717181205749512,
      "rmse_dx": 0.01961464248597622,
      "rmse_dy": 0.010093429125845432,
      "rmse_mean": 0.03229329735040665,
      "rotation_flip": 0.01666666753590107,
      "sparse_tokens": 10151.0,
      "step": 3100,
      "turn_loss": 0.29407066106796265,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14407173387846126,
      "grad_norm": 0.6595991253852844,
      "learning_rate": 8.526172053615122e-06,
      "loss": 0.1765,
      "mae_dtheta": 0.013505829498171806,
      "mae_dx": 0.0025820324663072824,
      "mae_dy": 0.0028083918150514364,
      "pose_mae_dtheta": 0.08969523012638092,
      "pose_mae_dx": 0.0300152450799942,
      "pose_mae_dy": 0.035837817937135696,
      "pose_rmse_dtheta": 0.19962985813617706,
      "pose_rmse_dx": 0.08617901802062988,
      "pose_rmse_dy": 0.09517596662044525,
      "pose_rmse_mean": 0.12699495255947113,
      "rmse_dtheta": 0.02618076093494892,
      "rmse_dx": 0.007906138896942139,
      "rmse_dy": 0.006698490586131811,
      "rmse_mean": 0.013595129363238811,
      "rotation_flip": 0.008702859282493591,
      "sparse_tokens": 32073.0,
      "step": 3101,
      "turn_loss": 0.11146077513694763,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.14411819364430403,
      "grad_norm": 0.5657193660736084,
      "learning_rate": 8.525234511073352e-06,
      "loss": 0.1867,
      "mae_dtheta": 0.03378799185156822,
      "mae_dx": 0.008845929987728596,
      "mae_dy": 0.003309704130515456,
      "pose_mae_dtheta": 0.2726925015449524,
      "pose_mae_dx": 0.07144532352685928,
      "pose_mae_dy": 0.0491439588367939,
      "pose_rmse_dtheta": 0.48744431138038635,
      "pose_rmse_dx": 0.18000642955303192,
      "pose_rmse_dy": 0.10887795686721802,
      "pose_rmse_mean": 0.2587762475013733,
      "rmse_dtheta": 0.052477236837148666,
      "rmse_dx": 0.020197579637169838,
      "rmse_dy": 0.006251433398574591,
      "rmse_mean": 0.026308750733733177,
      "rotation_flip": 0.010848126374185085,
      "sparse_tokens": 17245.0,
      "step": 3102,
      "turn_loss": 0.22614707052707672,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 18128.0,
      "epoch": 0.1441646534101468,
      "grad_norm": 0.7157161235809326,
      "learning_rate": 8.524296722010042e-06,
      "loss": 0.147,
      "mae_dtheta": 0.03358854725956917,
      "mae_dx": 0.012385979294776917,
      "mae_dy": 0.004951585084199905,
      "pose_mae_dtheta": 0.25991830229759216,
      "pose_mae_dx": 0.10957543551921844,
      "pose_mae_dy": 0.06718021631240845,
      "pose_rmse_dtheta": 0.48049452900886536,
      "pose_rmse_dx": 0.24900344014167786,
      "pose_rmse_dy": 0.1453961580991745,
      "pose_rmse_mean": 0.29163140058517456,
      "rmse_dtheta": 0.05334264785051346,
      "rmse_dx": 0.02677818387746811,
      "rmse_dy": 0.008603439666330814,
      "rmse_mean": 0.02957475744187832,
      "rotation_flip": 0.007894736714661121,
      "sparse_tokens": 14506.0,
      "step": 3103,
      "turn_loss": 0.22457851469516754,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.14421111317598959,
      "grad_norm": 0.5729086995124817,
      "learning_rate": 8.523358686490772e-06,
      "loss": 0.1955,
      "mae_dtheta": 0.027203015983104706,
      "mae_dx": 0.007887598127126694,
      "mae_dy": 0.004881071392446756,
      "pose_mae_dtheta": 0.1987314522266388,
      "pose_mae_dx": 0.0736202672123909,
      "pose_mae_dy": 0.06604872643947601,
      "pose_rmse_dtheta": 0.360157310962677,
      "pose_rmse_dx": 0.16294357180595398,
      "pose_rmse_dy": 0.1493937075138092,
      "pose_rmse_mean": 0.22416484355926514,
      "rmse_dtheta": 0.042789001017808914,
      "rmse_dx": 0.01843162626028061,
      "rmse_dy": 0.009844807907938957,
      "rmse_mean": 0.023688478395342827,
      "rotation_flip": 0.006793478038161993,
      "sparse_tokens": 14747.0,
      "step": 3104,
      "turn_loss": 0.2288123518228531,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 27816.0,
      "epoch": 0.14425757294183236,
      "grad_norm": 0.5240181684494019,
      "learning_rate": 8.522420404581135e-06,
      "loss": 0.1376,
      "mae_dtheta": 0.03876131772994995,
      "mae_dx": 0.009823908098042011,
      "mae_dy": 0.005281629040837288,
      "pose_mae_dtheta": 0.31436988711357117,
      "pose_mae_dx": 0.0898047611117363,
      "pose_mae_dy": 0.053631264716386795,
      "pose_rmse_dtheta": 0.5714169144630432,
      "pose_rmse_dx": 0.19694936275482178,
      "pose_rmse_dy": 0.11580821871757507,
      "pose_rmse_mean": 0.29472482204437256,
      "rmse_dtheta": 0.05838533490896225,
      "rmse_dx": 0.01996569149196148,
      "rmse_dy": 0.011113345623016357,
      "rmse_mean": 0.02982145920395851,
      "rotation_flip": 0.0117647061124444,
      "sparse_tokens": 21576.0,
      "step": 3105,
      "turn_loss": 0.27693262696266174,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14430403270767514,
      "grad_norm": 0.3998332917690277,
      "learning_rate": 8.521481876346751e-06,
      "loss": 0.0972,
      "mae_dtheta": 0.010209879837930202,
      "mae_dx": 0.002282642526552081,
      "mae_dy": 0.0023827431723475456,
      "pose_mae_dtheta": 0.07729164510965347,
      "pose_mae_dx": 0.028359992429614067,
      "pose_mae_dy": 0.027860257774591446,
      "pose_rmse_dtheta": 0.22814206779003143,
      "pose_rmse_dx": 0.080577053129673,
      "pose_rmse_dy": 0.08169886469841003,
      "pose_rmse_mean": 0.1301393359899521,
      "rmse_dtheta": 0.026758847758173943,
      "rmse_dx": 0.006832414772361517,
      "rmse_dy": 0.005980018526315689,
      "rmse_mean": 0.013190427795052528,
      "rotation_flip": 0.004826254677027464,
      "sparse_tokens": 32105.0,
      "step": 3106,
      "turn_loss": 0.09240802377462387,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.14435049247351794,
      "grad_norm": 0.5202369093894958,
      "learning_rate": 8.520543101853249e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.04860587418079376,
      "mae_dx": 0.01271880604326725,
      "mae_dy": 0.012990362010896206,
      "pose_mae_dtheta": 0.36835649609565735,
      "pose_mae_dx": 0.1322847604751587,
      "pose_mae_dy": 0.12619797885417938,
      "pose_rmse_dtheta": 0.5709843039512634,
      "pose_rmse_dx": 0.2614215016365051,
      "pose_rmse_dy": 0.2752806842327118,
      "pose_rmse_mean": 0.3692288398742676,
      "rmse_dtheta": 0.0665687844157219,
      "rmse_dx": 0.02339751459658146,
      "rmse_dy": 0.024115819483995438,
      "rmse_mean": 0.03802737221121788,
      "rotation_flip": 0.016483517363667488,
      "sparse_tokens": 11771.0,
      "step": 3107,
      "turn_loss": 0.5200985670089722,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14439695223936072,
      "grad_norm": 0.6079343557357788,
      "learning_rate": 8.519604081166278e-06,
      "loss": 0.1694,
      "mae_dtheta": 0.00958198681473732,
      "mae_dx": 0.001459361519664526,
      "mae_dy": 0.0022971262224018574,
      "pose_mae_dtheta": 0.06203676387667656,
      "pose_mae_dx": 0.01892547495663166,
      "pose_mae_dy": 0.029278870671987534,
      "pose_rmse_dtheta": 0.11914416402578354,
      "pose_rmse_dx": 0.05004090443253517,
      "pose_rmse_dy": 0.06441817432641983,
      "pose_rmse_mean": 0.07786774635314941,
      "rmse_dtheta": 0.01848224364221096,
      "rmse_dx": 0.0044749039225280285,
      "rmse_dy": 0.0053360057063400745,
      "rmse_mean": 0.009431051090359688,
      "rotation_flip": 0.004767580423504114,
      "sparse_tokens": 32057.0,
      "step": 3108,
      "turn_loss": 0.07700487226247787,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1444434120052035,
      "grad_norm": 0.39942148327827454,
      "learning_rate": 8.518664814351502e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.011501401662826538,
      "mae_dx": 0.002335053402930498,
      "mae_dy": 0.0029089816380292177,
      "pose_mae_dtheta": 0.07862552255392075,
      "pose_mae_dx": 0.02224196307361126,
      "pose_mae_dy": 0.02586745284497738,
      "pose_rmse_dtheta": 0.22033262252807617,
      "pose_rmse_dx": 0.06529660522937775,
      "pose_rmse_dy": 0.07018633931875229,
      "pose_rmse_mean": 0.11860518902540207,
      "rmse_dtheta": 0.02721945010125637,
      "rmse_dx": 0.007742224261164665,
      "rmse_dy": 0.008160453289747238,
      "rmse_mean": 0.014374042861163616,
      "rotation_flip": 0.0031298904214054346,
      "sparse_tokens": 32153.0,
      "step": 3109,
      "turn_loss": 0.09395086765289307,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2632.0,
      "epoch": 0.14448987177104627,
      "grad_norm": 0.9586042761802673,
      "learning_rate": 8.517725301474611e-06,
      "loss": 0.1412,
      "mae_dtheta": 0.03923949971795082,
      "mae_dx": 0.016261903569102287,
      "mae_dy": 0.005297922994941473,
      "pose_mae_dtheta": 0.33215638995170593,
      "pose_mae_dx": 0.11526105552911758,
      "pose_mae_dy": 0.03667173162102699,
      "pose_rmse_dtheta": 0.4750901162624359,
      "pose_rmse_dx": 0.2332431972026825,
      "pose_rmse_dy": 0.06460084021091461,
      "pose_rmse_mean": 0.2576447129249573,
      "rmse_dtheta": 0.054194215685129166,
      "rmse_dx": 0.028912654146552086,
      "rmse_dy": 0.009841639548540115,
      "rmse_mean": 0.030982837080955505,
      "rotation_flip": 0.007874015718698502,
      "sparse_tokens": 2277.0,
      "step": 3110,
      "turn_loss": 0.36670368909835815,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.14453633153688905,
      "grad_norm": 0.7420834302902222,
      "learning_rate": 8.516785542601298e-06,
      "loss": 0.2092,
      "mae_dtheta": 0.04470077157020569,
      "mae_dx": 0.01213659718632698,
      "mae_dy": 0.007768693380057812,
      "pose_mae_dtheta": 0.3693423271179199,
      "pose_mae_dx": 0.09675201773643494,
      "pose_mae_dy": 0.06201411038637161,
      "pose_rmse_dtheta": 0.6009091138839722,
      "pose_rmse_dx": 0.2025700807571411,
      "pose_rmse_dy": 0.12664128839969635,
      "pose_rmse_mean": 0.3100401759147644,
      "rmse_dtheta": 0.062420040369033813,
      "rmse_dx": 0.02367781288921833,
      "rmse_dy": 0.017461510375142097,
      "rmse_mean": 0.03451978787779808,
      "rotation_flip": 0.01171875,
      "sparse_tokens": 8331.0,
      "step": 3111,
      "turn_loss": 0.4019857347011566,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14458279130273183,
      "grad_norm": 0.5742078423500061,
      "learning_rate": 8.515845537797287e-06,
      "loss": 0.1106,
      "mae_dtheta": 0.009539308026432991,
      "mae_dx": 0.002309744246304035,
      "mae_dy": 0.0019352773670107126,
      "pose_mae_dtheta": 0.06554517894983292,
      "pose_mae_dx": 0.027172714471817017,
      "pose_mae_dy": 0.023160124197602272,
      "pose_rmse_dtheta": 0.15946528315544128,
      "pose_rmse_dx": 0.07414852827787399,
      "pose_rmse_dy": 0.05477854609489441,
      "pose_rmse_mean": 0.09613078832626343,
      "rmse_dtheta": 0.0206838920712471,
      "rmse_dx": 0.007336381357163191,
      "rmse_dy": 0.004382083658128977,
      "rmse_mean": 0.010800786316394806,
      "rotation_flip": 0.003021148033440113,
      "sparse_tokens": 32105.0,
      "step": 3112,
      "turn_loss": 0.07336031645536423,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.1446292510685746,
      "grad_norm": 0.5723954439163208,
      "learning_rate": 8.51490528712831e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.030223486945033073,
      "mae_dx": 0.011854879558086395,
      "mae_dy": 0.0055238730274140835,
      "pose_mae_dtheta": 0.23686249554157257,
      "pose_mae_dx": 0.1042553260922432,
      "pose_mae_dy": 0.06033540517091751,
      "pose_rmse_dtheta": 0.43924468755722046,
      "pose_rmse_dx": 0.22315683960914612,
      "pose_rmse_dy": 0.12660080194473267,
      "pose_rmse_mean": 0.2630007863044739,
      "rmse_dtheta": 0.04655035585165024,
      "rmse_dx": 0.024479728192090988,
      "rmse_dy": 0.009802726097404957,
      "rmse_mean": 0.026944270357489586,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 13085.0,
      "step": 3113,
      "turn_loss": 0.2204846292734146,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.14467571083441738,
      "grad_norm": 1.2192583084106445,
      "learning_rate": 8.513964790660118e-06,
      "loss": 0.2975,
      "mae_dtheta": 0.021646713837981224,
      "mae_dx": 0.006985855754464865,
      "mae_dy": 0.005061703734099865,
      "pose_mae_dtheta": 0.16044414043426514,
      "pose_mae_dx": 0.052109040319919586,
      "pose_mae_dy": 0.0560309998691082,
      "pose_rmse_dtheta": 0.3399379849433899,
      "pose_rmse_dx": 0.1237693578004837,
      "pose_rmse_dy": 0.13957209885120392,
      "pose_rmse_mean": 0.2010931372642517,
      "rmse_dtheta": 0.03771878406405449,
      "rmse_dx": 0.01616523787379265,
      "rmse_dy": 0.010957443155348301,
      "rmse_mean": 0.021613821387290955,
      "rotation_flip": 0.010071942582726479,
      "sparse_tokens": 13665.0,
      "step": 3114,
      "turn_loss": 0.21321916580200195,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.14472217060026019,
      "grad_norm": 0.8121989369392395,
      "learning_rate": 8.513024048458484e-06,
      "loss": 0.2245,
      "mae_dtheta": 0.03675723448395729,
      "mae_dx": 0.013121258467435837,
      "mae_dy": 0.003955714870244265,
      "pose_mae_dtheta": 0.3007163405418396,
      "pose_mae_dx": 0.10773931443691254,
      "pose_mae_dy": 0.05304450914263725,
      "pose_rmse_dtheta": 0.5379724502563477,
      "pose_rmse_dx": 0.22424563765525818,
      "pose_rmse_dy": 0.1271204650402069,
      "pose_rmse_mean": 0.29644620418548584,
      "rmse_dtheta": 0.05684081092476845,
      "rmse_dx": 0.025845887139439583,
      "rmse_dy": 0.008831314742565155,
      "rmse_mean": 0.030506005510687828,
      "rotation_flip": 0.014721346087753773,
      "sparse_tokens": 15277.0,
      "step": 3115,
      "turn_loss": 0.23195022344589233,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14476863036610296,
      "grad_norm": 0.62190842628479,
      "learning_rate": 8.512083060589193e-06,
      "loss": 0.1375,
      "mae_dtheta": 0.008890829049050808,
      "mae_dx": 0.001961587928235531,
      "mae_dy": 0.001917213317938149,
      "pose_mae_dtheta": 0.06546195596456528,
      "pose_mae_dx": 0.02510329894721508,
      "pose_mae_dy": 0.026328394189476967,
      "pose_rmse_dtheta": 0.1444542407989502,
      "pose_rmse_dx": 0.0669604018330574,
      "pose_rmse_dy": 0.06278007477521896,
      "pose_rmse_mean": 0.09139823913574219,
      "rmse_dtheta": 0.0191373061388731,
      "rmse_dx": 0.006078497506678104,
      "rmse_dy": 0.004842561203986406,
      "rmse_mean": 0.0100194551050663,
      "rotation_flip": 0.0033783784601837397,
      "sparse_tokens": 32057.0,
      "step": 3116,
      "turn_loss": 0.07408031076192856,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.14481509013194574,
      "grad_norm": 0.5421488881111145,
      "learning_rate": 8.511141827118047e-06,
      "loss": 0.1036,
      "mae_dtheta": 0.011051681824028492,
      "mae_dx": 0.0027309211436659098,
      "mae_dy": 0.003186360001564026,
      "pose_mae_dtheta": 0.08025025576353073,
      "pose_mae_dx": 0.03533628582954407,
      "pose_mae_dy": 0.03889130428433418,
      "pose_rmse_dtheta": 0.16105623543262482,
      "pose_rmse_dx": 0.09265295416116714,
      "pose_rmse_dy": 0.09795936942100525,
      "pose_rmse_mean": 0.117222860455513,
      "rmse_dtheta": 0.021335875615477562,
      "rmse_dx": 0.008455918170511723,
      "rmse_dy": 0.007177836261689663,
      "rmse_mean": 0.012323210947215557,
      "rotation_flip": 0.004807692486792803,
      "sparse_tokens": 32089.0,
      "step": 3117,
      "turn_loss": 0.10570210218429565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14486154989778852,
      "grad_norm": 0.632678747177124,
      "learning_rate": 8.510200348110868e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.01058167964220047,
      "mae_dx": 0.002030374715104699,
      "mae_dy": 0.002512057079002261,
      "pose_mae_dtheta": 0.07429799437522888,
      "pose_mae_dx": 0.02635250799357891,
      "pose_mae_dy": 0.032628193497657776,
      "pose_rmse_dtheta": 0.1530865728855133,
      "pose_rmse_dx": 0.06207215040922165,
      "pose_rmse_dy": 0.07659647613763809,
      "pose_rmse_mean": 0.09725173562765121,
      "rmse_dtheta": 0.021167201921343803,
      "rmse_dx": 0.005945627577602863,
      "rmse_dy": 0.004957608412951231,
      "rmse_mean": 0.010690147057175636,
      "rotation_flip": 0.004422999452799559,
      "sparse_tokens": 32073.0,
      "step": 3118,
      "turn_loss": 0.09199118614196777,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.1449080096636313,
      "grad_norm": 1.4149478673934937,
      "learning_rate": 8.509258623633496e-06,
      "loss": 0.2772,
      "mae_dtheta": 0.040002018213272095,
      "mae_dx": 0.016762750223279,
      "mae_dy": 0.004823071416467428,
      "pose_mae_dtheta": 0.32050609588623047,
      "pose_mae_dx": 0.12721335887908936,
      "pose_mae_dy": 0.05033717304468155,
      "pose_rmse_dtheta": 0.5614911913871765,
      "pose_rmse_dx": 0.26465076208114624,
      "pose_rmse_dy": 0.12788818776607513,
      "pose_rmse_mean": 0.3180100619792938,
      "rmse_dtheta": 0.05894200876355171,
      "rmse_dx": 0.030598202720284462,
      "rmse_dy": 0.009796260856091976,
      "rmse_mean": 0.03311216086149216,
      "rotation_flip": 0.013876843266189098,
      "sparse_tokens": 16766.0,
      "step": 3119,
      "turn_loss": 0.2824804484844208,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.14495446942947407,
      "grad_norm": 2.1546576023101807,
      "learning_rate": 8.508316653751785e-06,
      "loss": 0.269,
      "mae_dtheta": 0.04223065450787544,
      "mae_dx": 0.01130684930831194,
      "mae_dy": 0.0036496154498308897,
      "pose_mae_dtheta": 0.37106379866600037,
      "pose_mae_dx": 0.07395608723163605,
      "pose_mae_dy": 0.048435695469379425,
      "pose_rmse_dtheta": 0.5784510970115662,
      "pose_rmse_dx": 0.1710241287946701,
      "pose_rmse_dy": 0.11543454229831696,
      "pose_rmse_mean": 0.2883032560348511,
      "rmse_dtheta": 0.061247918754816055,
      "rmse_dx": 0.023652374744415283,
      "rmse_dy": 0.008168199099600315,
      "rmse_mean": 0.031022829934954643,
      "rotation_flip": 0.0181818176060915,
      "sparse_tokens": 5410.0,
      "step": 3120,
      "turn_loss": 0.2863660752773285,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 21035.0,
      "epoch": 0.14500092919531685,
      "grad_norm": 0.7203421592712402,
      "learning_rate": 8.507374438531606e-06,
      "loss": 0.127,
      "mae_dtheta": 0.04046846181154251,
      "mae_dx": 0.013906062580645084,
      "mae_dy": 0.006385109852999449,
      "pose_mae_dtheta": 0.32878440618515015,
      "pose_mae_dx": 0.12315447628498077,
      "pose_mae_dy": 0.07988675683736801,
      "pose_rmse_dtheta": 0.5213995575904846,
      "pose_rmse_dx": 0.2678166329860687,
      "pose_rmse_dy": 0.15509331226348877,
      "pose_rmse_mean": 0.31476983428001404,
      "rmse_dtheta": 0.0556347519159317,
      "rmse_dx": 0.027085362002253532,
      "rmse_dy": 0.012048548087477684,
      "rmse_mean": 0.031589556485414505,
      "rotation_flip": 0.014478764496743679,
      "sparse_tokens": 16400.0,
      "step": 3121,
      "turn_loss": 0.3662043809890747,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.14504738896115962,
      "grad_norm": 0.8505969047546387,
      "learning_rate": 8.506431978038851e-06,
      "loss": 0.1965,
      "mae_dtheta": 0.011653930880129337,
      "mae_dx": 0.0035031887236982584,
      "mae_dy": 0.0029565526638180017,
      "pose_mae_dtheta": 0.09602531790733337,
      "pose_mae_dx": 0.04345045983791351,
      "pose_mae_dy": 0.03975401446223259,
      "pose_rmse_dtheta": 0.24998825788497925,
      "pose_rmse_dx": 0.10553569346666336,
      "pose_rmse_dy": 0.10871385037899017,
      "pose_rmse_mean": 0.1547459363937378,
      "rmse_dtheta": 0.027691612020134926,
      "rmse_dx": 0.007920857518911362,
      "rmse_dy": 0.0077357725240290165,
      "rmse_mean": 0.014449415728449821,
      "rotation_flip": 0.002439024392515421,
      "sparse_tokens": 32137.0,
      "step": 3122,
      "turn_loss": 0.13308218121528625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.14509384872700243,
      "grad_norm": 0.6623013019561768,
      "learning_rate": 8.505489272339427e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.0381322018802166,
      "mae_dx": 0.01764245517551899,
      "mae_dy": 0.007444229908287525,
      "pose_mae_dtheta": 0.2878478765487671,
      "pose_mae_dx": 0.13970749080181122,
      "pose_mae_dy": 0.08487406373023987,
      "pose_rmse_dtheta": 0.4106086790561676,
      "pose_rmse_dx": 0.2680571973323822,
      "pose_rmse_dy": 0.19218622148036957,
      "pose_rmse_mean": 0.29028403759002686,
      "rmse_dtheta": 0.05166378617286682,
      "rmse_dx": 0.02980848401784897,
      "rmse_dy": 0.014066586270928383,
      "rmse_mean": 0.03184628486633301,
      "rotation_flip": 0.020797226577997208,
      "sparse_tokens": 10791.0,
      "step": 3123,
      "turn_loss": 0.34776824712753296,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 38940.0,
      "epoch": 0.1451403084928452,
      "grad_norm": 0.4749530851840973,
      "learning_rate": 8.504546321499255e-06,
      "loss": 0.1324,
      "mae_dtheta": 0.0375414676964283,
      "mae_dx": 0.014171072281897068,
      "mae_dy": 0.004431399051100016,
      "pose_mae_dtheta": 0.285991907119751,
      "pose_mae_dx": 0.11826381832361221,
      "pose_mae_dy": 0.0563831590116024,
      "pose_rmse_dtheta": 0.5104866623878479,
      "pose_rmse_dx": 0.25326335430145264,
      "pose_rmse_dy": 0.13894912600517273,
      "pose_rmse_mean": 0.3008997142314911,
      "rmse_dtheta": 0.057535987347364426,
      "rmse_dx": 0.027243321761488914,
      "rmse_dy": 0.008639995008707047,
      "rmse_mean": 0.031139766797423363,
      "rotation_flip": 0.010074230842292309,
      "sparse_tokens": 29764.0,
      "step": 3124,
      "turn_loss": 0.28238001465797424,
      "turns": 120.0,
      "turns_per_sample": 120.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14518676825868798,
      "grad_norm": 0.4845487177371979,
      "learning_rate": 8.503603125584279e-06,
      "loss": 0.1238,
      "mae_dtheta": 0.010055916383862495,
      "mae_dx": 0.002663329243659973,
      "mae_dy": 0.002546184929087758,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4845487177371979,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.32073974609375,
      "model/head/act_norm_mean": 113.66016611426768,
      "model/head/act_norm_min": 62.29134750366211,
      "model/head/act_over_embed": 78.10833025696513,
      "model/head/grad_frac": 0.0944802537560463,
      "model/head/grad_norm": 0.04578028619289398,
      "model/head/grad_zero_frac": 0.00018465216271579266,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6906762941919192,
      "model/head/update_ratio": 0.0007896499591879547,
      "model/head/weight_delta": 6.553233623504639,
      "model/head/weight_delta_rel": 0.11496312916278839,
      "model/head/weight_norm": 57.97541809082031,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41626042127609253,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41619226430029077,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4161278009414673,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2860112204805278,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08742745965719223,
      "model/modality_embedder.encoders.pose/grad_norm": 0.042362865060567856,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5343942684977578,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013742489973083138,
      "model/modality_embedder.encoders.pose/weight_delta": 2.141608238220215,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.06997301429510117,
      "model/modality_embedder.encoders.pose/weight_norm": 30.82619285583496,
      "model/modality_embedder/grad_frac": 0.08742745965719223,
      "model/modality_embedder/grad_norm": 0.042362865060567856,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5343942684977578,
      "model/modality_embedder/update_ratio": 0.0013742489973083138,
      "model/modality_embedder/weight_delta": 2.141608238220215,
      "model/modality_embedder/weight_delta_rel": 0.06997301429510117,
      "model/modality_embedder/weight_norm": 30.82619285583496,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.62104797363281,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.87768558601892,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.98498821258545,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.40896908112669,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09289219230413437,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04501079395413399,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016254945658147335,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.4499348402023315,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.052836500108242035,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.690523147583008,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.07356262207031,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.950053611511944,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.375872611999512,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.145910427913126,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07948103547096252,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03851243481040001,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001313782879151404,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.825020670890808,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06322014331817627,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.31415557861328,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.68670654296875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.929460778419113,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.460675239562988,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.5061775645136,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07733698934316635,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.037473540753126144,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012384410947561264,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.9553507566452026,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06565701961517334,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.258638381958008,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.45010375976562,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.770550244508577,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.449869155883789,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.771391482161427,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07464196532964706,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03616767004132271,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012217412004247308,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.669175624847412,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05704450234770775,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.60338020324707,
      "model/normalizer/grad_frac": 0.31920793652534485,
      "model/normalizer/grad_norm": 0.1546718031167984,
      "model/normalizer/grad_zero_frac": 0.0001737155398586765,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001979258842766285,
      "model/normalizer/weight_delta": 3.552154779434204,
      "model/normalizer/weight_delta_rel": 0.04574969783425331,
      "model/normalizer/weight_norm": 78.14632415771484,
      "pose_mae_dtheta": 0.06534093618392944,
      "pose_mae_dx": 0.024668985977768898,
      "pose_mae_dy": 0.02464708872139454,
      "pose_rmse_dtheta": 0.13784602284431458,
      "pose_rmse_dx": 0.06528899073600769,
      "pose_rmse_dy": 0.055035367608070374,
      "pose_rmse_mean": 0.08605679124593735,
      "rmse_dtheta": 0.020123593509197235,
      "rmse_dx": 0.00819425843656063,
      "rmse_dy": 0.006125000771135092,
      "rmse_mean": 0.011480951681733131,
      "rotation_flip": 0.00599700165912509,
      "sparse_tokens": 32105.0,
      "step": 3125,
      "turn_loss": 0.09420298784971237,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14523322802453076,
      "grad_norm": 0.6137108206748962,
      "learning_rate": 8.502659684660455e-06,
      "loss": 0.141,
      "mae_dtheta": 0.015522210858762264,
      "mae_dx": 0.0027721610385924578,
      "mae_dy": 0.003992676269263029,
      "pose_mae_dtheta": 0.1037609800696373,
      "pose_mae_dx": 0.033517010509967804,
      "pose_mae_dy": 0.04274832084774971,
      "pose_rmse_dtheta": 0.21577702462673187,
      "pose_rmse_dx": 0.09046411514282227,
      "pose_rmse_dy": 0.08299844712018967,
      "pose_rmse_mean": 0.12974654138088226,
      "rmse_dtheta": 0.02888570912182331,
      "rmse_dx": 0.007709914352744818,
      "rmse_dy": 0.008893572725355625,
      "rmse_mean": 0.015163065865635872,
      "rotation_flip": 0.0074249072931706905,
      "sparse_tokens": 32105.0,
      "step": 3126,
      "turn_loss": 0.13462097942829132,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.14527968779037354,
      "grad_norm": 0.5282133221626282,
      "learning_rate": 8.501715998793758e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.012920071370899677,
      "mae_dx": 0.002266481053084135,
      "mae_dy": 0.002671698573976755,
      "pose_mae_dtheta": 0.08780628442764282,
      "pose_mae_dx": 0.029663965106010437,
      "pose_mae_dy": 0.039077069610357285,
      "pose_rmse_dtheta": 0.1738148331642151,
      "pose_rmse_dx": 0.08108490705490112,
      "pose_rmse_dy": 0.08180134743452072,
      "pose_rmse_mean": 0.11223369836807251,
      "rmse_dtheta": 0.02264896221458912,
      "rmse_dx": 0.007939699105918407,
      "rmse_dy": 0.005285300780087709,
      "rmse_mean": 0.01195798721164465,
      "rotation_flip": 0.0077893175184726715,
      "sparse_tokens": 32041.0,
      "step": 3127,
      "turn_loss": 0.09808370471000671,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.1453261475562163,
      "grad_norm": 0.4832617938518524,
      "learning_rate": 8.500772068050183e-06,
      "loss": 0.12,
      "mae_dtheta": 0.03600877523422241,
      "mae_dx": 0.006914077792316675,
      "mae_dy": 0.00746439304202795,
      "pose_mae_dtheta": 0.2766047716140747,
      "pose_mae_dx": 0.06422974169254303,
      "pose_mae_dy": 0.08828940987586975,
      "pose_rmse_dtheta": 0.6045143604278564,
      "pose_rmse_dx": 0.16076402366161346,
      "pose_rmse_dy": 0.2496999055147171,
      "pose_rmse_mean": 0.338326096534729,
      "rmse_dtheta": 0.06245085597038269,
      "rmse_dx": 0.014357942156493664,
      "rmse_dy": 0.017949780449271202,
      "rmse_mean": 0.031586192548274994,
      "rotation_flip": 0.007575757801532745,
      "sparse_tokens": 4437.0,
      "step": 3128,
      "turn_loss": 0.3037559688091278,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1453726073220591,
      "grad_norm": 0.5222360491752625,
      "learning_rate": 8.49982789249574e-06,
      "loss": 0.0909,
      "mae_dtheta": 0.009280135855078697,
      "mae_dx": 0.0020948373712599277,
      "mae_dy": 0.0017256897408515215,
      "pose_mae_dtheta": 0.06833481788635254,
      "pose_mae_dx": 0.023448817431926727,
      "pose_mae_dy": 0.02406087890267372,
      "pose_rmse_dtheta": 0.20065361261367798,
      "pose_rmse_dx": 0.06499083340167999,
      "pose_rmse_dy": 0.06623411178588867,
      "pose_rmse_mean": 0.11062618345022202,
      "rmse_dtheta": 0.023025600239634514,
      "rmse_dx": 0.006851085461676121,
      "rmse_dy": 0.004034270066767931,
      "rmse_mean": 0.011303652077913284,
      "rotation_flip": 0.003833515802398324,
      "sparse_tokens": 32073.0,
      "step": 3129,
      "turn_loss": 0.07023292779922485,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.14541906708790187,
      "grad_norm": 0.5363897681236267,
      "learning_rate": 8.498883472196451e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.014168400317430496,
      "mae_dx": 0.003245377214625478,
      "mae_dy": 0.0030937690753489733,
      "pose_mae_dtheta": 0.1071811392903328,
      "pose_mae_dx": 0.02754116617143154,
      "pose_mae_dy": 0.028534604236483574,
      "pose_rmse_dtheta": 0.28306570649147034,
      "pose_rmse_dx": 0.06789566576480865,
      "pose_rmse_dy": 0.08309232443571091,
      "pose_rmse_mean": 0.1446845829486847,
      "rmse_dtheta": 0.032374583184719086,
      "rmse_dx": 0.00926915928721428,
      "rmse_dy": 0.009124819189310074,
      "rmse_mean": 0.016922853887081146,
      "rotation_flip": 0.0029607696924358606,
      "sparse_tokens": 32169.0,
      "step": 3130,
      "turn_loss": 0.12093780189752579,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14546552685374467,
      "grad_norm": 0.3899365961551666,
      "learning_rate": 8.497938807218365e-06,
      "loss": 0.1155,
      "mae_dtheta": 0.00938904657959938,
      "mae_dx": 0.00246546627022326,
      "mae_dy": 0.0026223042514175177,
      "pose_mae_dtheta": 0.06046299636363983,
      "pose_mae_dx": 0.02201840840280056,
      "pose_mae_dy": 0.02350679039955139,
      "pose_rmse_dtheta": 0.15134695172309875,
      "pose_rmse_dx": 0.05962072312831879,
      "pose_rmse_dy": 0.06045345962047577,
      "pose_rmse_mean": 0.0904737114906311,
      "rmse_dtheta": 0.02315635420382023,
      "rmse_dx": 0.007961297407746315,
      "rmse_dy": 0.008187668398022652,
      "rmse_mean": 0.013101774267852306,
      "rotation_flip": 0.004429134074598551,
      "sparse_tokens": 32105.0,
      "step": 3131,
      "turn_loss": 0.09964890778064728,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.14551198661958745,
      "grad_norm": 0.3303230404853821,
      "learning_rate": 8.49699389762754e-06,
      "loss": 0.0833,
      "mae_dtheta": 0.00808623991906643,
      "mae_dx": 0.0019103974336758256,
      "mae_dy": 0.0011191966477781534,
      "pose_mae_dtheta": 0.06104318052530289,
      "pose_mae_dx": 0.017641793936491013,
      "pose_mae_dy": 0.018154820427298546,
      "pose_rmse_dtheta": 0.18312448263168335,
      "pose_rmse_dx": 0.04317770525813103,
      "pose_rmse_dy": 0.042563144117593765,
      "pose_rmse_mean": 0.08962178230285645,
      "rmse_dtheta": 0.021411605179309845,
      "rmse_dx": 0.006050672847777605,
      "rmse_dy": 0.0024000138510018587,
      "rmse_mean": 0.009954097680747509,
      "rotation_flip": 0.0014563106233254075,
      "sparse_tokens": 32137.0,
      "step": 3132,
      "turn_loss": 0.06723934412002563,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.14555844638543022,
      "grad_norm": 0.42350900173187256,
      "learning_rate": 8.496048743490053e-06,
      "loss": 0.1086,
      "mae_dtheta": 0.010892916470766068,
      "mae_dx": 0.0022480955813080072,
      "mae_dy": 0.0020531262271106243,
      "pose_mae_dtheta": 0.07220397889614105,
      "pose_mae_dx": 0.025357762351632118,
      "pose_mae_dy": 0.02319485694169998,
      "pose_rmse_dtheta": 0.19420908391475677,
      "pose_rmse_dx": 0.05490303039550781,
      "pose_rmse_dy": 0.057615552097558975,
      "pose_rmse_mean": 0.10224255919456482,
      "rmse_dtheta": 0.025378840044140816,
      "rmse_dx": 0.006116960197687149,
      "rmse_dy": 0.004412116017192602,
      "rmse_mean": 0.011969305574893951,
      "rotation_flip": 0.00781555287539959,
      "sparse_tokens": 32153.0,
      "step": 3133,
      "turn_loss": 0.08839692920446396,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.145604906151273,
      "grad_norm": 1.417048692703247,
      "learning_rate": 8.495103344872005e-06,
      "loss": 0.2382,
      "mae_dtheta": 0.025081507861614227,
      "mae_dx": 0.011142324656248093,
      "mae_dy": 0.0058194673620164394,
      "pose_mae_dtheta": 0.1920723170042038,
      "pose_mae_dx": 0.09080462157726288,
      "pose_mae_dy": 0.07980240136384964,
      "pose_rmse_dtheta": 0.34180447459220886,
      "pose_rmse_dx": 0.20135366916656494,
      "pose_rmse_dy": 0.17531080543994904,
      "pose_rmse_mean": 0.23948965966701508,
      "rmse_dtheta": 0.04043189063668251,
      "rmse_dx": 0.023365359753370285,
      "rmse_dy": 0.011955196969211102,
      "rmse_mean": 0.025250814855098724,
      "rotation_flip": 0.014322916977107525,
      "sparse_tokens": 14281.0,
      "step": 3134,
      "turn_loss": 0.2158057540655136,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.14565136591711578,
      "grad_norm": 0.49187543988227844,
      "learning_rate": 8.4941577018395e-06,
      "loss": 0.1825,
      "mae_dtheta": 0.03580687567591667,
      "mae_dx": 0.012516947463154793,
      "mae_dy": 0.004879451356828213,
      "pose_mae_dtheta": 0.2961183190345764,
      "pose_mae_dx": 0.08644809573888779,
      "pose_mae_dy": 0.04897524043917656,
      "pose_rmse_dtheta": 0.5019318461418152,
      "pose_rmse_dx": 0.18271903693675995,
      "pose_rmse_dy": 0.1257352977991104,
      "pose_rmse_mean": 0.2701287269592285,
      "rmse_dtheta": 0.05413882061839104,
      "rmse_dx": 0.024327585473656654,
      "rmse_dy": 0.01043075043708086,
      "rmse_mean": 0.029632387682795525,
      "rotation_flip": 0.0077220075763762,
      "sparse_tokens": 16060.0,
      "step": 3135,
      "turn_loss": 0.3068942129611969,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14569782568295855,
      "grad_norm": 0.52374267578125,
      "learning_rate": 8.493211814458674e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.010214405134320259,
      "mae_dx": 0.0023899637162685394,
      "mae_dy": 0.0025046379305422306,
      "pose_mae_dtheta": 0.07165608555078506,
      "pose_mae_dx": 0.029631972312927246,
      "pose_mae_dy": 0.0353727787733078,
      "pose_rmse_dtheta": 0.13691779971122742,
      "pose_rmse_dx": 0.06757959723472595,
      "pose_rmse_dy": 0.07138504087924957,
      "pose_rmse_mean": 0.09196081012487411,
      "rmse_dtheta": 0.018847081810235977,
      "rmse_dx": 0.007170840632170439,
      "rmse_dy": 0.004478076472878456,
      "rmse_mean": 0.01016533374786377,
      "rotation_flip": 0.004216671921312809,
      "sparse_tokens": 32121.0,
      "step": 3136,
      "turn_loss": 0.09254464507102966,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.14574428544880133,
      "grad_norm": 0.5038350820541382,
      "learning_rate": 8.49226568279567e-06,
      "loss": 0.1073,
      "mae_dtheta": 0.03916262835264206,
      "mae_dx": 0.012682860717177391,
      "mae_dy": 0.003925632685422897,
      "pose_mae_dtheta": 0.31277984380722046,
      "pose_mae_dx": 0.09297230839729309,
      "pose_mae_dy": 0.0476553738117218,
      "pose_rmse_dtheta": 0.539361834526062,
      "pose_rmse_dx": 0.19019201397895813,
      "pose_rmse_dy": 0.13965030014514923,
      "pose_rmse_mean": 0.28973472118377686,
      "rmse_dtheta": 0.06180524080991745,
      "rmse_dx": 0.02525698021054268,
      "rmse_dy": 0.00924144871532917,
      "rmse_mean": 0.03210122510790825,
      "rotation_flip": 0.010638297535479069,
      "sparse_tokens": 6019.0,
      "step": 3137,
      "turn_loss": 0.20549388229846954,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.1457907452146441,
      "grad_norm": 0.5024901032447815,
      "learning_rate": 8.491319306916654e-06,
      "loss": 0.0995,
      "mae_dtheta": 0.029085110872983932,
      "mae_dx": 0.01316023524850607,
      "mae_dy": 0.0041662598960101604,
      "pose_mae_dtheta": 0.22344978153705597,
      "pose_mae_dx": 0.1052732914686203,
      "pose_mae_dy": 0.05007271468639374,
      "pose_rmse_dtheta": 0.4265384078025818,
      "pose_rmse_dx": 0.2618127763271332,
      "pose_rmse_dy": 0.13670051097869873,
      "pose_rmse_mean": 0.27501723170280457,
      "rmse_dtheta": 0.04932497814297676,
      "rmse_dx": 0.027865778654813766,
      "rmse_dy": 0.008896431885659695,
      "rmse_mean": 0.02869573049247265,
      "rotation_flip": 0.016317015513777733,
      "sparse_tokens": 9630.0,
      "step": 3138,
      "turn_loss": 0.21575897932052612,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 12999.0,
      "epoch": 0.1458372049804869,
      "grad_norm": 0.5269041061401367,
      "learning_rate": 8.490372686887802e-06,
      "loss": 0.1353,
      "mae_dtheta": 0.023753350600600243,
      "mae_dx": 0.009719313122332096,
      "mae_dy": 0.007225083652883768,
      "pose_mae_dtheta": 0.16054776310920715,
      "pose_mae_dx": 0.07187105715274811,
      "pose_mae_dy": 0.05405701696872711,
      "pose_rmse_dtheta": 0.335392564535141,
      "pose_rmse_dx": 0.19297021627426147,
      "pose_rmse_dy": 0.1432105302810669,
      "pose_rmse_mean": 0.22385776042938232,
      "rmse_dtheta": 0.04268129542469978,
      "rmse_dx": 0.022366326302289963,
      "rmse_dy": 0.01748848706483841,
      "rmse_mean": 0.02751203626394272,
      "rotation_flip": 0.01918976567685604,
      "sparse_tokens": 11006.0,
      "step": 3139,
      "turn_loss": 0.21578443050384521,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.1458836647463297,
      "grad_norm": 0.48078930377960205,
      "learning_rate": 8.489425822775317e-06,
      "loss": 0.1473,
      "mae_dtheta": 0.021820589900016785,
      "mae_dx": 0.007987404242157936,
      "mae_dy": 0.005670703481882811,
      "pose_mae_dtheta": 0.15019915997982025,
      "pose_mae_dx": 0.07591185718774796,
      "pose_mae_dy": 0.08031830936670303,
      "pose_rmse_dtheta": 0.24722792208194733,
      "pose_rmse_dx": 0.20820751786231995,
      "pose_rmse_dy": 0.15703371167182922,
      "pose_rmse_mean": 0.20415639877319336,
      "rmse_dtheta": 0.03395400568842888,
      "rmse_dx": 0.020605487748980522,
      "rmse_dy": 0.009817419573664665,
      "rmse_mean": 0.021458972245454788,
      "rotation_flip": 0.012422360479831696,
      "sparse_tokens": 11971.0,
      "step": 3140,
      "turn_loss": 0.2312672883272171,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.14593012451217247,
      "grad_norm": 0.4794692099094391,
      "learning_rate": 8.48847871464541e-06,
      "loss": 0.1263,
      "mae_dtheta": 0.010183947160840034,
      "mae_dx": 0.002674472751095891,
      "mae_dy": 0.00258263829164207,
      "pose_mae_dtheta": 0.07449193298816681,
      "pose_mae_dx": 0.028378698974847794,
      "pose_mae_dy": 0.03234011307358742,
      "pose_rmse_dtheta": 0.18158109486103058,
      "pose_rmse_dx": 0.06254473328590393,
      "pose_rmse_dy": 0.07329709827899933,
      "pose_rmse_mean": 0.10580764710903168,
      "rmse_dtheta": 0.022942231968045235,
      "rmse_dx": 0.006961493752896786,
      "rmse_dy": 0.005449462682008743,
      "rmse_mean": 0.011784396134316921,
      "rotation_flip": 0.004442798905074596,
      "sparse_tokens": 32153.0,
      "step": 3141,
      "turn_loss": 0.10128176957368851,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17536.0,
      "epoch": 0.14597658427801524,
      "grad_norm": 0.4907371699810028,
      "learning_rate": 8.487531362564314e-06,
      "loss": 0.1339,
      "mae_dtheta": 0.030741041526198387,
      "mae_dx": 0.01520620472729206,
      "mae_dy": 0.004031499847769737,
      "pose_mae_dtheta": 0.21493694186210632,
      "pose_mae_dx": 0.1179981678724289,
      "pose_mae_dy": 0.03907683119177818,
      "pose_rmse_dtheta": 0.3783475458621979,
      "pose_rmse_dx": 0.27945011854171753,
      "pose_rmse_dy": 0.0857795849442482,
      "pose_rmse_mean": 0.24785910546779633,
      "rmse_dtheta": 0.046226467937231064,
      "rmse_dx": 0.02946513146162033,
      "rmse_dy": 0.008192313835024834,
      "rmse_mean": 0.027961304411292076,
      "rotation_flip": 0.0167525764554739,
      "sparse_tokens": 13305.0,
      "step": 3142,
      "turn_loss": 0.2901887893676758,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14602304404385802,
      "grad_norm": 0.434787392616272,
      "learning_rate": 8.486583766598278e-06,
      "loss": 0.1121,
      "mae_dtheta": 0.009386001154780388,
      "mae_dx": 0.0013711029896512628,
      "mae_dy": 0.0021672772709280252,
      "pose_mae_dtheta": 0.06578800827264786,
      "pose_mae_dx": 0.019865499809384346,
      "pose_mae_dy": 0.031665753573179245,
      "pose_rmse_dtheta": 0.13264666497707367,
      "pose_rmse_dx": 0.053235430270433426,
      "pose_rmse_dy": 0.07087527960538864,
      "pose_rmse_mean": 0.08558579534292221,
      "rmse_dtheta": 0.018757732585072517,
      "rmse_dx": 0.004365555942058563,
      "rmse_dy": 0.005015742965042591,
      "rmse_mean": 0.009379677474498749,
      "rotation_flip": 0.004699247889220715,
      "sparse_tokens": 32057.0,
      "step": 3143,
      "turn_loss": 0.07920337468385696,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8141.0,
      "epoch": 0.1460695038097008,
      "grad_norm": 0.5234364867210388,
      "learning_rate": 8.485635926813569e-06,
      "loss": 0.1154,
      "mae_dtheta": 0.03405506908893585,
      "mae_dx": 0.010582526214420795,
      "mae_dy": 0.003481514984741807,
      "pose_mae_dtheta": 0.28386256098747253,
      "pose_mae_dx": 0.0881112664937973,
      "pose_mae_dy": 0.04480891674757004,
      "pose_rmse_dtheta": 0.519740641117096,
      "pose_rmse_dx": 0.22900454699993134,
      "pose_rmse_dy": 0.10086556524038315,
      "pose_rmse_mean": 0.2832036018371582,
      "rmse_dtheta": 0.053003549575805664,
      "rmse_dx": 0.02378159947693348,
      "rmse_dy": 0.00645805150270462,
      "rmse_mean": 0.027747733518481255,
      "rotation_flip": 0.02666666731238365,
      "sparse_tokens": 6730.0,
      "step": 3144,
      "turn_loss": 0.21264973282814026,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14611596357554357,
      "grad_norm": 0.4220835566520691,
      "learning_rate": 8.48468784327647e-06,
      "loss": 0.1355,
      "mae_dtheta": 0.012168911285698414,
      "mae_dx": 0.0022144471295177937,
      "mae_dy": 0.002220713533461094,
      "pose_mae_dtheta": 0.08226673305034637,
      "pose_mae_dx": 0.02683396264910698,
      "pose_mae_dy": 0.02932817116379738,
      "pose_rmse_dtheta": 0.2035321593284607,
      "pose_rmse_dx": 0.05920713394880295,
      "pose_rmse_dy": 0.0781465470790863,
      "pose_rmse_mean": 0.11362861841917038,
      "rmse_dtheta": 0.026190979406237602,
      "rmse_dx": 0.005845288746058941,
      "rmse_dy": 0.004725923761725426,
      "rmse_mean": 0.012254064902663231,
      "rotation_flip": 0.0030674845911562443,
      "sparse_tokens": 32121.0,
      "step": 3145,
      "turn_loss": 0.0903414934873581,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25556.0,
      "epoch": 0.14616242334138635,
      "grad_norm": 0.5278262495994568,
      "learning_rate": 8.483739516053276e-06,
      "loss": 0.1537,
      "mae_dtheta": 0.039449542760849,
      "mae_dx": 0.01171143539249897,
      "mae_dy": 0.008848804049193859,
      "pose_mae_dtheta": 0.3157186508178711,
      "pose_mae_dx": 0.11147044599056244,
      "pose_mae_dy": 0.11968671530485153,
      "pose_rmse_dtheta": 0.5396969318389893,
      "pose_rmse_dx": 0.23494425415992737,
      "pose_rmse_dy": 0.26492613554000854,
      "pose_rmse_mean": 0.34652242064476013,
      "rmse_dtheta": 0.05841214954853058,
      "rmse_dx": 0.023918762803077698,
      "rmse_dy": 0.017303191125392914,
      "rmse_mean": 0.033211369067430496,
      "rotation_flip": 0.018041236326098442,
      "sparse_tokens": 21298.0,
      "step": 3146,
      "turn_loss": 0.38642799854278564,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.14620888310722913,
      "grad_norm": 0.6151535511016846,
      "learning_rate": 8.482790945210309e-06,
      "loss": 0.0899,
      "mae_dtheta": 0.02931728959083557,
      "mae_dx": 0.010796046815812588,
      "mae_dy": 0.007276386953890324,
      "pose_mae_dtheta": 0.21599507331848145,
      "pose_mae_dx": 0.08868450671434402,
      "pose_mae_dy": 0.07169747352600098,
      "pose_rmse_dtheta": 0.40566620230674744,
      "pose_rmse_dx": 0.2220301479101181,
      "pose_rmse_dy": 0.22221416234970093,
      "pose_rmse_mean": 0.28330349922180176,
      "rmse_dtheta": 0.0462685190141201,
      "rmse_dx": 0.023879840970039368,
      "rmse_dy": 0.017455652356147766,
      "rmse_mean": 0.029201339930295944,
      "rotation_flip": 0.01037344429641962,
      "sparse_tokens": 8730.0,
      "step": 3147,
      "turn_loss": 0.2278018742799759,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14625534287307193,
      "grad_norm": 0.4291146993637085,
      "learning_rate": 8.481842130813904e-06,
      "loss": 0.0807,
      "mae_dtheta": 0.00824558362364769,
      "mae_dx": 0.0017618100391700864,
      "mae_dy": 0.001565421000123024,
      "pose_mae_dtheta": 0.05782341584563255,
      "pose_mae_dx": 0.019340313971042633,
      "pose_mae_dy": 0.019199321046471596,
      "pose_rmse_dtheta": 0.1586274355649948,
      "pose_rmse_dx": 0.049301814287900925,
      "pose_rmse_dy": 0.0532350167632103,
      "pose_rmse_mean": 0.08705475926399231,
      "rmse_dtheta": 0.020906466990709305,
      "rmse_dx": 0.005568395368754864,
      "rmse_dy": 0.004028222057968378,
      "rmse_mean": 0.010167695581912994,
      "rotation_flip": 0.007608695421367884,
      "sparse_tokens": 32105.0,
      "step": 3148,
      "turn_loss": 0.0675181970000267,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.1463018026389147,
      "grad_norm": 0.4775761365890503,
      "learning_rate": 8.480893072930407e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.03034459613263607,
      "mae_dx": 0.011550732888281345,
      "mae_dy": 0.003717906540259719,
      "pose_mae_dtheta": 0.25239816308021545,
      "pose_mae_dx": 0.08259256184101105,
      "pose_mae_dy": 0.053762707859277725,
      "pose_rmse_dtheta": 0.5277504324913025,
      "pose_rmse_dx": 0.2124914824962616,
      "pose_rmse_dy": 0.1541864573955536,
      "pose_rmse_mean": 0.29814279079437256,
      "rmse_dtheta": 0.05222859978675842,
      "rmse_dx": 0.02468474581837654,
      "rmse_dy": 0.008396458812057972,
      "rmse_mean": 0.028436601161956787,
      "rotation_flip": 0.007393715437501669,
      "sparse_tokens": 10405.0,
      "step": 3149,
      "turn_loss": 0.20357871055603027,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14634826240475748,
      "grad_norm": 0.4541928172111511,
      "learning_rate": 8.47994377162619e-06,
      "loss": 0.115,
      "mae_dtheta": 0.013399515300989151,
      "mae_dx": 0.002170032123103738,
      "mae_dy": 0.0026306731160730124,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4541926681995392,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.58067321777344,
      "model/head/act_norm_mean": 114.75824652777777,
      "model/head/act_norm_min": 75.78545379638672,
      "model/head/act_over_embed": 78.86294139752007,
      "model/head/grad_frac": 0.10980530828237534,
      "model/head/grad_norm": 0.04987276718020439,
      "model/head/grad_zero_frac": 0.00017069221939891577,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6966639046717171,
      "model/head/update_ratio": 0.0008601538138464093,
      "model/head/weight_delta": 6.580318927764893,
      "model/head/weight_delta_rel": 0.11543828248977661,
      "model/head/weight_norm": 57.98122024536133,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4162435829639435,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4161434086490439,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4160776734352112,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28597764641959716,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09469003230333328,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04300751909613609,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.4946400542237443,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013950768625363708,
      "model/modality_embedder.encoders.pose/weight_delta": 2.1574008464813232,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07048901170492172,
      "model/modality_embedder.encoders.pose/weight_norm": 30.82806396484375,
      "model/modality_embedder/grad_frac": 0.09469003230333328,
      "model/modality_embedder/grad_norm": 0.04300751909613609,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.4946400542237443,
      "model/modality_embedder/update_ratio": 0.0013950768625363708,
      "model/modality_embedder/weight_delta": 2.1574008464813232,
      "model/modality_embedder/weight_delta_rel": 0.07048901170492172,
      "model/modality_embedder/weight_norm": 30.82806396484375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.16300201416016,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.912089646464647,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.969382286071777,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.43261187356088,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0787312313914299,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03575914725661278,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012913396349176764,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.4587510824203491,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05315776914358139,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.691511154174805,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.56043243408203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.90786586099086,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.373153686523438,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.116918610787096,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08270861208438873,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03756564483046532,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012813607463613153,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.8362982273101807,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06361080706119537,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.316993713378906,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.48600006103516,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.78163079204746,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.095399856567383,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.40458741387286,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08641240745782852,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03924788162112236,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012969373492524028,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.967372179031372,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06606067717075348,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.261972427368164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.1501235961914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.621427569344235,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.009563446044922,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.66891298368001,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09448558837175369,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04291466251015663,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014495312934741378,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.6794099807739258,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05739426240324974,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.60588836669922,
      "model/normalizer/grad_frac": 0.32963132858276367,
      "model/normalizer/grad_norm": 0.14971613883972168,
      "model/normalizer/grad_zero_frac": 0.00022453030396718532,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001915765111334622,
      "model/normalizer/weight_delta": 3.573869228363037,
      "model/normalizer/weight_delta_rel": 0.04602936655282974,
      "model/normalizer/weight_norm": 78.14952850341797,
      "pose_mae_dtheta": 0.09736824035644531,
      "pose_mae_dx": 0.030452381819486618,
      "pose_mae_dy": 0.03789953887462616,
      "pose_rmse_dtheta": 0.22794823348522186,
      "pose_rmse_dx": 0.0842895433306694,
      "pose_rmse_dy": 0.09864193201065063,
      "pose_rmse_mean": 0.13695991039276123,
      "rmse_dtheta": 0.027265289798378944,
      "rmse_dx": 0.007370893843472004,
      "rmse_dy": 0.005727150943130255,
      "rmse_mean": 0.013454444706439972,
      "rotation_flip": 0.006355931982398033,
      "sparse_tokens": 32073.0,
      "step": 3150,
      "turn_loss": 0.09694930911064148,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14639472217060026,
      "grad_norm": 0.606216311454773,
      "learning_rate": 8.478994226967638e-06,
      "loss": 0.1562,
      "mae_dtheta": 0.011664641089737415,
      "mae_dx": 0.002212279010564089,
      "mae_dy": 0.0024068246129900217,
      "pose_mae_dtheta": 0.07856310158967972,
      "pose_mae_dx": 0.026222461834549904,
      "pose_mae_dy": 0.030186111107468605,
      "pose_rmse_dtheta": 0.18548798561096191,
      "pose_rmse_dx": 0.06916511058807373,
      "pose_rmse_dy": 0.0748024731874466,
      "pose_rmse_mean": 0.10981851816177368,
      "rmse_dtheta": 0.024205373600125313,
      "rmse_dx": 0.00684873154386878,
      "rmse_dy": 0.004956298973411322,
      "rmse_mean": 0.012003468349575996,
      "rotation_flip": 0.006907137576490641,
      "sparse_tokens": 32121.0,
      "step": 3151,
      "turn_loss": 0.07652049511671066,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25235.0,
      "epoch": 0.14644118193644304,
      "grad_norm": 0.885128378868103,
      "learning_rate": 8.478044439021154e-06,
      "loss": 0.3058,
      "mae_dtheta": 0.032763972878456116,
      "mae_dx": 0.01104318629950285,
      "mae_dy": 0.004720792174339294,
      "pose_mae_dtheta": 0.2615158259868622,
      "pose_mae_dx": 0.09313999116420746,
      "pose_mae_dy": 0.06641697883605957,
      "pose_rmse_dtheta": 0.4360896050930023,
      "pose_rmse_dx": 0.21840256452560425,
      "pose_rmse_dy": 0.14924925565719604,
      "pose_rmse_mean": 0.267913818359375,
      "rmse_dtheta": 0.047897063195705414,
      "rmse_dx": 0.02394009195268154,
      "rmse_dy": 0.00908571481704712,
      "rmse_mean": 0.02697429060935974,
      "rotation_flip": 0.007332722190767527,
      "sparse_tokens": 20290.0,
      "step": 3152,
      "turn_loss": 0.28846749663352966,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.14648764170228581,
      "grad_norm": 0.6046112179756165,
      "learning_rate": 8.477094407853153e-06,
      "loss": 0.1748,
      "mae_dtheta": 0.036117006093263626,
      "mae_dx": 0.009663875214755535,
      "mae_dy": 0.004638570360839367,
      "pose_mae_dtheta": 0.2639532685279846,
      "pose_mae_dx": 0.07889162003993988,
      "pose_mae_dy": 0.04995587095618248,
      "pose_rmse_dtheta": 0.4782487750053406,
      "pose_rmse_dx": 0.20049744844436646,
      "pose_rmse_dy": 0.1226508691906929,
      "pose_rmse_mean": 0.26713237166404724,
      "rmse_dtheta": 0.05556527525186539,
      "rmse_dx": 0.021829821169376373,
      "rmse_dy": 0.009435421787202358,
      "rmse_mean": 0.028943507000803947,
      "rotation_flip": 0.02058319002389908,
      "sparse_tokens": 8990.0,
      "step": 3153,
      "turn_loss": 0.3473113775253296,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.1465341014681286,
      "grad_norm": 0.8415630459785461,
      "learning_rate": 8.476144133530076e-06,
      "loss": 0.1568,
      "mae_dtheta": 0.0140417804941535,
      "mae_dx": 0.003814711468294263,
      "mae_dy": 0.002195716602727771,
      "pose_mae_dtheta": 0.1009635403752327,
      "pose_mae_dx": 0.03519706800580025,
      "pose_mae_dy": 0.0211713295429945,
      "pose_rmse_dtheta": 0.29525670409202576,
      "pose_rmse_dx": 0.08088921010494232,
      "pose_rmse_dy": 0.06018524616956711,
      "pose_rmse_mean": 0.14544372260570526,
      "rmse_dtheta": 0.034850962460041046,
      "rmse_dx": 0.00978196132928133,
      "rmse_dy": 0.006528174504637718,
      "rmse_mean": 0.017053699120879173,
      "rotation_flip": 0.003461918793618679,
      "sparse_tokens": 32185.0,
      "step": 3154,
      "turn_loss": 0.1445465236902237,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.14658056123397137,
      "grad_norm": 0.5672645568847656,
      "learning_rate": 8.475193616118371e-06,
      "loss": 0.1023,
      "mae_dtheta": 0.009369269013404846,
      "mae_dx": 0.002235151594504714,
      "mae_dy": 0.001755731413140893,
      "pose_mae_dtheta": 0.06891610473394394,
      "pose_mae_dx": 0.020861800760030746,
      "pose_mae_dy": 0.02457479014992714,
      "pose_rmse_dtheta": 0.18235209584236145,
      "pose_rmse_dx": 0.05377596616744995,
      "pose_rmse_dy": 0.10117592662572861,
      "pose_rmse_mean": 0.11243467032909393,
      "rmse_dtheta": 0.022899677976965904,
      "rmse_dx": 0.00690040085464716,
      "rmse_dy": 0.005484676919877529,
      "rmse_mean": 0.011761586181819439,
      "rotation_flip": 0.00481231976300478,
      "sparse_tokens": 32137.0,
      "step": 3155,
      "turn_loss": 0.0793742761015892,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14662702099981417,
      "grad_norm": 0.49821072816848755,
      "learning_rate": 8.474242855684514e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.015829365700483322,
      "mae_dx": 0.0038727133069187403,
      "mae_dy": 0.00459530483931303,
      "pose_mae_dtheta": 0.11667149513959885,
      "pose_mae_dx": 0.047413211315870285,
      "pose_mae_dy": 0.054000306874513626,
      "pose_rmse_dtheta": 0.24113237857818604,
      "pose_rmse_dx": 0.106172114610672,
      "pose_rmse_dy": 0.11793962121009827,
      "pose_rmse_mean": 0.1550813764333725,
      "rmse_dtheta": 0.02964825928211212,
      "rmse_dx": 0.010074520483613014,
      "rmse_dy": 0.009294059127569199,
      "rmse_mean": 0.016338946297764778,
      "rotation_flip": 0.009459459222853184,
      "sparse_tokens": 32105.0,
      "step": 3156,
      "turn_loss": 0.16142219305038452,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.14667348076565695,
      "grad_norm": 0.4798240065574646,
      "learning_rate": 8.473291852294986e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.036602433770895004,
      "mae_dx": 0.017043493688106537,
      "mae_dy": 0.008873251266777515,
      "pose_mae_dtheta": 0.23717865347862244,
      "pose_mae_dx": 0.13866782188415527,
      "pose_mae_dy": 0.08734056353569031,
      "pose_rmse_dtheta": 0.38261643052101135,
      "pose_rmse_dx": 0.3126916289329529,
      "pose_rmse_dy": 0.1539052128791809,
      "pose_rmse_mean": 0.2830711007118225,
      "rmse_dtheta": 0.055637091398239136,
      "rmse_dx": 0.03188430145382881,
      "rmse_dy": 0.017399989068508148,
      "rmse_mean": 0.03497379273176193,
      "rotation_flip": 0.020512821152806282,
      "sparse_tokens": 3559.0,
      "step": 3157,
      "turn_loss": 0.3513234853744507,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14671994053149973,
      "grad_norm": 0.46418648958206177,
      "learning_rate": 8.472340606016298e-06,
      "loss": 0.1349,
      "mae_dtheta": 0.00848736148327589,
      "mae_dx": 0.0014645000919699669,
      "mae_dy": 0.0012236086186021566,
      "pose_mae_dtheta": 0.06834056973457336,
      "pose_mae_dx": 0.01680486463010311,
      "pose_mae_dy": 0.021303553134202957,
      "pose_rmse_dtheta": 0.22232578694820404,
      "pose_rmse_dx": 0.04736504703760147,
      "pose_rmse_dy": 0.05162914842367172,
      "pose_rmse_mean": 0.10710667073726654,
      "rmse_dtheta": 0.023363223299384117,
      "rmse_dx": 0.004928312264382839,
      "rmse_dy": 0.0025380749721080065,
      "rmse_mean": 0.010276537388563156,
      "rotation_flip": 0.004244997166097164,
      "sparse_tokens": 32073.0,
      "step": 3158,
      "turn_loss": 0.06781265139579773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.1467664002973425,
      "grad_norm": 0.47720053791999817,
      "learning_rate": 8.471389116914965e-06,
      "loss": 0.142,
      "mae_dtheta": 0.032577645033597946,
      "mae_dx": 0.012837282381951809,
      "mae_dy": 0.0037384910974651575,
      "pose_mae_dtheta": 0.24646323919296265,
      "pose_mae_dx": 0.10285577178001404,
      "pose_mae_dy": 0.03525074943900108,
      "pose_rmse_dtheta": 0.41854390501976013,
      "pose_rmse_dx": 0.22881470620632172,
      "pose_rmse_dy": 0.09487452358007431,
      "pose_rmse_mean": 0.24741104245185852,
      "rmse_dtheta": 0.0506126694381237,
      "rmse_dx": 0.025202617049217224,
      "rmse_dy": 0.009189608506858349,
      "rmse_mean": 0.028334965929389,
      "rotation_flip": 0.014686248265206814,
      "sparse_tokens": 14247.0,
      "step": 3159,
      "turn_loss": 0.24302025139331818,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.14681286006318528,
      "grad_norm": 0.5861285328865051,
      "learning_rate": 8.470437385057531e-06,
      "loss": 0.1661,
      "mae_dtheta": 0.03291802108287811,
      "mae_dx": 0.007782348897308111,
      "mae_dy": 0.00619581388309598,
      "pose_mae_dtheta": 0.2737632095813751,
      "pose_mae_dx": 0.07432316243648529,
      "pose_mae_dy": 0.06513876467943192,
      "pose_rmse_dtheta": 0.44138526916503906,
      "pose_rmse_dx": 0.16742122173309326,
      "pose_rmse_dy": 0.1412074863910675,
      "pose_rmse_mean": 0.2500046491622925,
      "rmse_dtheta": 0.04972616583108902,
      "rmse_dx": 0.018102401867508888,
      "rmse_dy": 0.011360456235706806,
      "rmse_mean": 0.026396341621875763,
      "rotation_flip": 0.025899279862642288,
      "sparse_tokens": 12444.0,
      "step": 3160,
      "turn_loss": 0.2703593373298645,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.14685931982902806,
      "grad_norm": 0.8510542511940002,
      "learning_rate": 8.469485410510545e-06,
      "loss": 0.3315,
      "mae_dtheta": 0.03012922964990139,
      "mae_dx": 0.013005740940570831,
      "mae_dy": 0.001540119992569089,
      "pose_mae_dtheta": 0.24372592568397522,
      "pose_mae_dx": 0.10289278626441956,
      "pose_mae_dy": 0.017180562019348145,
      "pose_rmse_dtheta": 0.49152523279190063,
      "pose_rmse_dx": 0.23336446285247803,
      "pose_rmse_dy": 0.058539241552352905,
      "pose_rmse_mean": 0.2611429691314697,
      "rmse_dtheta": 0.05126854404807091,
      "rmse_dx": 0.02626213990151882,
      "rmse_dy": 0.0031602445524185896,
      "rmse_mean": 0.026896975934505463,
      "rotation_flip": 0.01955307275056839,
      "sparse_tokens": 7199.0,
      "step": 3161,
      "turn_loss": 0.18110480904579163,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.14690577959487083,
      "grad_norm": 0.5888047814369202,
      "learning_rate": 8.468533193340585e-06,
      "loss": 0.1686,
      "mae_dtheta": 0.014811732806265354,
      "mae_dx": 0.004135447088629007,
      "mae_dy": 0.004868180025368929,
      "pose_mae_dtheta": 0.10317139327526093,
      "pose_mae_dx": 0.04783494397997856,
      "pose_mae_dy": 0.043886277824640274,
      "pose_rmse_dtheta": 0.22007550299167633,
      "pose_rmse_dx": 0.12855485081672668,
      "pose_rmse_dy": 0.10441779345273972,
      "pose_rmse_mean": 0.15101605653762817,
      "rmse_dtheta": 0.02894924394786358,
      "rmse_dx": 0.010428535751998425,
      "rmse_dy": 0.011512750759720802,
      "rmse_mean": 0.01696350984275341,
      "rotation_flip": 0.009105305187404156,
      "sparse_tokens": 32089.0,
      "step": 3162,
      "turn_loss": 0.156370148062706,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.1469522393607136,
      "grad_norm": 0.6427820324897766,
      "learning_rate": 8.467580733614233e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.033263325691223145,
      "mae_dx": 0.010468875989317894,
      "mae_dy": 0.00518490094691515,
      "pose_mae_dtheta": 0.270327091217041,
      "pose_mae_dx": 0.08476174622774124,
      "pose_mae_dy": 0.07417328655719757,
      "pose_rmse_dtheta": 0.46266642212867737,
      "pose_rmse_dx": 0.17783449590206146,
      "pose_rmse_dy": 0.14925239980220795,
      "pose_rmse_mean": 0.2632511258125305,
      "rmse_dtheta": 0.049826547503471375,
      "rmse_dx": 0.02259584702551365,
      "rmse_dy": 0.008831048384308815,
      "rmse_mean": 0.027084480971097946,
      "rotation_flip": 0.017640573903918266,
      "sparse_tokens": 15656.0,
      "step": 3163,
      "turn_loss": 0.2211630940437317,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 42058.0,
      "epoch": 0.14699869912655641,
      "grad_norm": 0.5273621082305908,
      "learning_rate": 8.466628031398103e-06,
      "loss": 0.1991,
      "mae_dtheta": 0.04627960920333862,
      "mae_dx": 0.016210919246077538,
      "mae_dy": 0.00640094093978405,
      "pose_mae_dtheta": 0.38487812876701355,
      "pose_mae_dx": 0.12950192391872406,
      "pose_mae_dy": 0.07521384954452515,
      "pose_rmse_dtheta": 0.6239376068115234,
      "pose_rmse_dx": 0.26748421788215637,
      "pose_rmse_dy": 0.1859082132577896,
      "pose_rmse_mean": 0.3591099977493286,
      "rmse_dtheta": 0.06524324417114258,
      "rmse_dx": 0.02943325601518154,
      "rmse_dy": 0.01410406082868576,
      "rmse_mean": 0.03626018762588501,
      "rotation_flip": 0.018164880573749542,
      "sparse_tokens": 30058.0,
      "step": 3164,
      "turn_loss": 0.3559768795967102,
      "turns": 130.0,
      "turns_per_sample": 130.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1470451588923992,
      "grad_norm": 0.5430774092674255,
      "learning_rate": 8.465675086758813e-06,
      "loss": 0.1821,
      "mae_dtheta": 0.015288355760276318,
      "mae_dx": 0.002494597574695945,
      "mae_dy": 0.004387313034385443,
      "pose_mae_dtheta": 0.09997572749853134,
      "pose_mae_dx": 0.03779406100511551,
      "pose_mae_dy": 0.050958551466464996,
      "pose_rmse_dtheta": 0.1945939064025879,
      "pose_rmse_dx": 0.08623840659856796,
      "pose_rmse_dy": 0.12551100552082062,
      "pose_rmse_mean": 0.13544778525829315,
      "rmse_dtheta": 0.02720688097178936,
      "rmse_dx": 0.0067896768450737,
      "rmse_dy": 0.00867497455328703,
      "rmse_mean": 0.014223845675587654,
      "rotation_flip": 0.007526177912950516,
      "sparse_tokens": 32105.0,
      "step": 3165,
      "turn_loss": 0.12691153585910797,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37964.0,
      "epoch": 0.14709161865824197,
      "grad_norm": 0.4705182611942291,
      "learning_rate": 8.464721899763003e-06,
      "loss": 0.1355,
      "mae_dtheta": 0.030961761251091957,
      "mae_dx": 0.013483340851962566,
      "mae_dy": 0.003296458860859275,
      "pose_mae_dtheta": 0.23633819818496704,
      "pose_mae_dx": 0.10766065120697021,
      "pose_mae_dy": 0.034255240112543106,
      "pose_rmse_dtheta": 0.4331834614276886,
      "pose_rmse_dx": 0.23799704015254974,
      "pose_rmse_dy": 0.09099211543798447,
      "pose_rmse_mean": 0.25405752658843994,
      "rmse_dtheta": 0.049691688269376755,
      "rmse_dx": 0.02666945941746235,
      "rmse_dy": 0.007169581018388271,
      "rmse_mean": 0.027843577787280083,
      "rotation_flip": 0.01500600203871727,
      "sparse_tokens": 29864.0,
      "step": 3166,
      "turn_loss": 0.2229602187871933,
      "turns": 117.0,
      "turns_per_sample": 117.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.14713807842408475,
      "grad_norm": 0.7570421099662781,
      "learning_rate": 8.463768470477331e-06,
      "loss": 0.126,
      "mae_dtheta": 0.03185424208641052,
      "mae_dx": 0.006798426155000925,
      "mae_dy": 0.007912303321063519,
      "pose_mae_dtheta": 0.22408011555671692,
      "pose_mae_dx": 0.09189565479755402,
      "pose_mae_dy": 0.10815668106079102,
      "pose_rmse_dtheta": 0.326193243265152,
      "pose_rmse_dx": 0.1727980524301529,
      "pose_rmse_dy": 0.22742144763469696,
      "pose_rmse_mean": 0.2421375960111618,
      "rmse_dtheta": 0.04114406555891037,
      "rmse_dx": 0.01310122013092041,
      "rmse_dy": 0.013386690057814121,
      "rmse_mean": 0.02254399284720421,
      "rotation_flip": 0.014563106931746006,
      "sparse_tokens": 3854.0,
      "step": 3167,
      "turn_loss": 0.26603832840919495,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 8439.0,
      "epoch": 0.14718453818992752,
      "grad_norm": 0.6210644841194153,
      "learning_rate": 8.462814798968472e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.04025625064969063,
      "mae_dx": 0.01417517475783825,
      "mae_dy": 0.004442605189979076,
      "pose_mae_dtheta": 0.3657838702201843,
      "pose_mae_dx": 0.11562203615903854,
      "pose_mae_dy": 0.05672962963581085,
      "pose_rmse_dtheta": 0.6376298069953918,
      "pose_rmse_dx": 0.23407597839832306,
      "pose_rmse_dy": 0.12598846852779388,
      "pose_rmse_mean": 0.3325647711753845,
      "rmse_dtheta": 0.0601237528026104,
      "rmse_dx": 0.02677115425467491,
      "rmse_dy": 0.008066258393228054,
      "rmse_mean": 0.03165372461080551,
      "rotation_flip": 0.016706444323062897,
      "sparse_tokens": 6975.0,
      "step": 3168,
      "turn_loss": 0.2750835418701172,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1472309979557703,
      "grad_norm": 0.6708977222442627,
      "learning_rate": 8.461860885303116e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.012111371383070946,
      "mae_dx": 0.0026188199408352375,
      "mae_dy": 0.0034424865152686834,
      "pose_mae_dtheta": 0.08724778145551682,
      "pose_mae_dx": 0.031233252957463264,
      "pose_mae_dy": 0.03437814489006996,
      "pose_rmse_dtheta": 0.22092628479003906,
      "pose_rmse_dx": 0.08008169382810593,
      "pose_rmse_dy": 0.09165780991315842,
      "pose_rmse_mean": 0.13088861107826233,
      "rmse_dtheta": 0.026870299130678177,
      "rmse_dx": 0.0070105381309986115,
      "rmse_dy": 0.00851084291934967,
      "rmse_mean": 0.01413056068122387,
      "rotation_flip": 0.0043459367007017136,
      "sparse_tokens": 32073.0,
      "step": 3169,
      "turn_loss": 0.11938101053237915,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14727745772161308,
      "grad_norm": 0.39219942688941956,
      "learning_rate": 8.460906729547968e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.011217424646019936,
      "mae_dx": 0.0027835879009217024,
      "mae_dy": 0.0022542618680745363,
      "pose_mae_dtheta": 0.08393847197294235,
      "pose_mae_dx": 0.03086545690894127,
      "pose_mae_dy": 0.031048299744725227,
      "pose_rmse_dtheta": 0.2072354108095169,
      "pose_rmse_dx": 0.08675849437713623,
      "pose_rmse_dy": 0.0918053463101387,
      "pose_rmse_mean": 0.12859974801540375,
      "rmse_dtheta": 0.024708278477191925,
      "rmse_dx": 0.008660276420414448,
      "rmse_dy": 0.005649921949952841,
      "rmse_mean": 0.013006158173084259,
      "rotation_flip": 0.0033594626002013683,
      "sparse_tokens": 32073.0,
      "step": 3170,
      "turn_loss": 0.08854363858699799,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.14732391748745585,
      "grad_norm": 0.4007197916507721,
      "learning_rate": 8.459952331769755e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.009871604852378368,
      "mae_dx": 0.0014514143113046885,
      "mae_dy": 0.002206413308158517,
      "pose_mae_dtheta": 0.06699740886688232,
      "pose_mae_dx": 0.02081761322915554,
      "pose_mae_dy": 0.025220973417162895,
      "pose_rmse_dtheta": 0.15253524482250214,
      "pose_rmse_dx": 0.04658292979001999,
      "pose_rmse_dy": 0.05238699913024902,
      "pose_rmse_mean": 0.08383505791425705,
      "rmse_dtheta": 0.020609937608242035,
      "rmse_dx": 0.0038056042976677418,
      "rmse_dy": 0.004789522849023342,
      "rmse_mean": 0.009735021740198135,
      "rotation_flip": 0.0007515971665270627,
      "sparse_tokens": 32089.0,
      "step": 3171,
      "turn_loss": 0.07907072454690933,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.14737037725329866,
      "grad_norm": 0.677757978439331,
      "learning_rate": 8.45899769203522e-06,
      "loss": 0.0926,
      "mae_dtheta": 0.03281881660223007,
      "mae_dx": 0.011663800105452538,
      "mae_dy": 0.005481450818479061,
      "pose_mae_dtheta": 0.23739232122898102,
      "pose_mae_dx": 0.10098390281200409,
      "pose_mae_dy": 0.06059533357620239,
      "pose_rmse_dtheta": 0.43915173411369324,
      "pose_rmse_dx": 0.2843942940235138,
      "pose_rmse_dy": 0.14061114192008972,
      "pose_rmse_mean": 0.28805240988731384,
      "rmse_dtheta": 0.04958408325910568,
      "rmse_dx": 0.026524044573307037,
      "rmse_dy": 0.0113965580239892,
      "rmse_mean": 0.029168229550123215,
      "rotation_flip": 0.0220994483679533,
      "sparse_tokens": 3221.0,
      "step": 3172,
      "turn_loss": 0.19193963706493378,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.14741683701914143,
      "grad_norm": 0.5522429347038269,
      "learning_rate": 8.458042810411118e-06,
      "loss": 0.1611,
      "mae_dtheta": 0.027032088488340378,
      "mae_dx": 0.008857007138431072,
      "mae_dy": 0.004450030159205198,
      "pose_mae_dtheta": 0.18791644275188446,
      "pose_mae_dx": 0.07535001635551453,
      "pose_mae_dy": 0.060982417315244675,
      "pose_rmse_dtheta": 0.33311209082603455,
      "pose_rmse_dx": 0.1825369894504547,
      "pose_rmse_dy": 0.12917743623256683,
      "pose_rmse_mean": 0.21494218707084656,
      "rmse_dtheta": 0.04278169572353363,
      "rmse_dx": 0.020467326045036316,
      "rmse_dy": 0.0075348298996686935,
      "rmse_mean": 0.02359461784362793,
      "rotation_flip": 0.004232804290950298,
      "sparse_tokens": 20223.0,
      "step": 3173,
      "turn_loss": 0.22169560194015503,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1474632967849842,
      "grad_norm": 0.5487626791000366,
      "learning_rate": 8.457087686964227e-06,
      "loss": 0.1574,
      "mae_dtheta": 0.016118399798870087,
      "mae_dx": 0.0024452204816043377,
      "mae_dy": 0.003876350587233901,
      "pose_mae_dtheta": 0.11216112971305847,
      "pose_mae_dx": 0.03633115440607071,
      "pose_mae_dy": 0.048861898481845856,
      "pose_rmse_dtheta": 0.23026293516159058,
      "pose_rmse_dx": 0.08041070401668549,
      "pose_rmse_dy": 0.10510412603616714,
      "pose_rmse_mean": 0.13859260082244873,
      "rmse_dtheta": 0.028499159961938858,
      "rmse_dx": 0.006905598100274801,
      "rmse_dy": 0.00705148046836257,
      "rmse_mean": 0.01415207888931036,
      "rotation_flip": 0.006728612817823887,
      "sparse_tokens": 32073.0,
      "step": 3174,
      "turn_loss": 0.13993173837661743,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.147509756550827,
      "grad_norm": 0.47986581921577454,
      "learning_rate": 8.45613232176134e-06,
      "loss": 0.1642,
      "mae_dtheta": 0.030419671908020973,
      "mae_dx": 0.008506538346409798,
      "mae_dy": 0.005618365481495857,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.47986581921577454,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 143.4625701904297,
      "model/head/act_norm_mean": 109.71303654813218,
      "model/head/act_norm_min": 73.90217590332031,
      "model/head/act_over_embed": 75.3958258655076,
      "model/head/grad_frac": 0.10869365930557251,
      "model/head/grad_norm": 0.05215837061405182,
      "model/head/grad_zero_frac": 0.00019829485972877592,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6831110811781609,
      "model/head/update_ratio": 0.000899459351785481,
      "model/head/weight_delta": 6.607934474945068,
      "model/head/weight_delta_rel": 0.11592274159193039,
      "model/head/weight_norm": 57.98857879638672,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41627851128578186,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41622447967529297,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41615068912506104,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2860333591878344,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1413584202528,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0678330734372139,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.4858176491477273,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0022002393379807472,
      "model/modality_embedder.encoders.pose/weight_delta": 2.166344404220581,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07078122347593307,
      "model/modality_embedder.encoders.pose/weight_norm": 30.829862594604492,
      "model/modality_embedder/grad_frac": 0.1413584202528,
      "model/modality_embedder/grad_norm": 0.0678330734372139,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.4858176491477273,
      "model/modality_embedder/update_ratio": 0.0022002393379807472,
      "model/modality_embedder/weight_delta": 2.166344404220581,
      "model/modality_embedder/weight_delta_rel": 0.07078122347593307,
      "model/modality_embedder/weight_norm": 30.829862594604492,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.93895721435547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.50137691570881,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.084562301635742,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.150366239832305,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08337636291980743,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04000946506857872,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014447624562308192,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.467399001121521,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05347290635108948,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.692764282226562,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 80.56613159179688,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.40376413975552,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.620054244995117,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.7704951884795,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08514197170734406,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04085672274231911,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013934822054579854,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.8478435277938843,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06401074677705765,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.319873809814453,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 82.3432388305664,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.12257115489874,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.151815414428711,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.951675461010726,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09288153052330017,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0445706732571125,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014726987574249506,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.9802119731903076,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06649181246757507,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.264623641967773,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.12623596191406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.059806034482758,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.555509567260742,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.282961406939553,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11692111194133759,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05610644444823265,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001895020715892315,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.6899206638336182,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05775346979498863,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.607297897338867,
      "model/normalizer/grad_frac": 0.5050819516181946,
      "model/normalizer/grad_norm": 0.2423715740442276,
      "model/normalizer/grad_zero_frac": 0.00023516594956163317,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0031012746039777994,
      "model/normalizer/weight_delta": 3.59627366065979,
      "model/normalizer/weight_delta_rel": 0.046317923814058304,
      "model/normalizer/weight_norm": 78.1522445678711,
      "pose_mae_dtheta": 0.22361548244953156,
      "pose_mae_dx": 0.06848668307065964,
      "pose_mae_dy": 0.06411071866750717,
      "pose_rmse_dtheta": 0.41760894656181335,
      "pose_rmse_dx": 0.1610134392976761,
      "pose_rmse_dy": 0.15114927291870117,
      "pose_rmse_mean": 0.24325722455978394,
      "rmse_dtheta": 0.04894715175032616,
      "rmse_dx": 0.01919589564204216,
      "rmse_dy": 0.011952709406614304,
      "rmse_mean": 0.026698585599660873,
      "rotation_flip": 0.013665595091879368,
      "sparse_tokens": 22520.0,
      "step": 3175,
      "turn_loss": 0.291082501411438,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.14755621631666976,
      "grad_norm": 0.4586005210876465,
      "learning_rate": 8.455176714869262e-06,
      "loss": 0.0648,
      "mae_dtheta": 0.008247663266956806,
      "mae_dx": 0.0017971686320379376,
      "mae_dy": 0.00031895076972432435,
      "pose_mae_dtheta": 0.06687825173139572,
      "pose_mae_dx": 0.013853749260306358,
      "pose_mae_dy": 0.004299002233892679,
      "pose_rmse_dtheta": 0.26919588446617126,
      "pose_rmse_dx": 0.03077329508960247,
      "pose_rmse_dy": 0.00911872461438179,
      "pose_rmse_mean": 0.10302930325269699,
      "rmse_dtheta": 0.02924042008817196,
      "rmse_dx": 0.004765691235661507,
      "rmse_dy": 0.0006639500497840345,
      "rmse_mean": 0.011556687764823437,
      "rotation_flip": 0.0011043621925637126,
      "sparse_tokens": 32249.0,
      "step": 3176,
      "turn_loss": 0.052030447870492935,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.14760267608251254,
      "grad_norm": 0.48059070110321045,
      "learning_rate": 8.454220866354825e-06,
      "loss": 0.1623,
      "mae_dtheta": 0.01007856149226427,
      "mae_dx": 0.0031464200001209974,
      "mae_dy": 0.0024039680138230324,
      "pose_mae_dtheta": 0.0665568858385086,
      "pose_mae_dx": 0.03342131897807121,
      "pose_mae_dy": 0.03205765038728714,
      "pose_rmse_dtheta": 0.17078055441379547,
      "pose_rmse_dx": 0.08745896816253662,
      "pose_rmse_dy": 0.0913718044757843,
      "pose_rmse_mean": 0.11653710901737213,
      "rmse_dtheta": 0.021085305139422417,
      "rmse_dx": 0.009669571183621883,
      "rmse_dy": 0.005996990017592907,
      "rmse_mean": 0.012250622734427452,
      "rotation_flip": 0.004203643184155226,
      "sparse_tokens": 32041.0,
      "step": 3177,
      "turn_loss": 0.1066347286105156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.14764913584835532,
      "grad_norm": 0.6393252015113831,
      "learning_rate": 8.453264776284867e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.03151581063866615,
      "mae_dx": 0.014851813204586506,
      "mae_dy": 0.0045852018520236015,
      "pose_mae_dtheta": 0.26483744382858276,
      "pose_mae_dx": 0.11962346732616425,
      "pose_mae_dy": 0.04845687747001648,
      "pose_rmse_dtheta": 0.4945025146007538,
      "pose_rmse_dx": 0.2507978081703186,
      "pose_rmse_dy": 0.12192168831825256,
      "pose_rmse_mean": 0.28907400369644165,
      "rmse_dtheta": 0.05060581490397453,
      "rmse_dx": 0.028048155829310417,
      "rmse_dy": 0.008329353295266628,
      "rmse_mean": 0.028994441032409668,
      "rotation_flip": 0.016371076926589012,
      "sparse_tokens": 12983.0,
      "step": 3178,
      "turn_loss": 0.24014002084732056,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1476955956141981,
      "grad_norm": 0.4971781373023987,
      "learning_rate": 8.452308444726249e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.014261780306696892,
      "mae_dx": 0.004232012201100588,
      "mae_dy": 0.005360315553843975,
      "pose_mae_dtheta": 0.10322679579257965,
      "pose_mae_dx": 0.05744194611907005,
      "pose_mae_dy": 0.052779462188482285,
      "pose_rmse_dtheta": 0.23709021508693695,
      "pose_rmse_dx": 0.149154931306839,
      "pose_rmse_dy": 0.15312957763671875,
      "pose_rmse_mean": 0.17979156970977783,
      "rmse_dtheta": 0.028651928529143333,
      "rmse_dx": 0.011355855502188206,
      "rmse_dy": 0.012985148467123508,
      "rmse_mean": 0.017664311453700066,
      "rotation_flip": 0.01074918545782566,
      "sparse_tokens": 32153.0,
      "step": 3179,
      "turn_loss": 0.16069449484348297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14774205538004087,
      "grad_norm": 0.3804984986782074,
      "learning_rate": 8.45135187174585e-06,
      "loss": 0.0935,
      "mae_dtheta": 0.015238432213664055,
      "mae_dx": 0.001878267154097557,
      "mae_dy": 0.003617155132815242,
      "pose_mae_dtheta": 0.1006433367729187,
      "pose_mae_dx": 0.03158705681562424,
      "pose_mae_dy": 0.04652351140975952,
      "pose_rmse_dtheta": 0.21420317888259888,
      "pose_rmse_dx": 0.07466388493776321,
      "pose_rmse_dy": 0.09783932566642761,
      "pose_rmse_mean": 0.1289021372795105,
      "rmse_dtheta": 0.02691507339477539,
      "rmse_dx": 0.004910590127110481,
      "rmse_dy": 0.006612615659832954,
      "rmse_mean": 0.012812758795917034,
      "rotation_flip": 0.007853402756154537,
      "sparse_tokens": 32073.0,
      "step": 3180,
      "turn_loss": 0.12206705659627914,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14778851514588368,
      "grad_norm": 0.40874621272087097,
      "learning_rate": 8.450395057410561e-06,
      "loss": 0.1087,
      "mae_dtheta": 0.010959277860820293,
      "mae_dx": 0.0019263208378106356,
      "mae_dy": 0.0026304912753403187,
      "pose_mae_dtheta": 0.07849239557981491,
      "pose_mae_dx": 0.025203168392181396,
      "pose_mae_dy": 0.03240374103188515,
      "pose_rmse_dtheta": 0.1796649694442749,
      "pose_rmse_dx": 0.0618714839220047,
      "pose_rmse_dy": 0.07475601136684418,
      "pose_rmse_mean": 0.10543082654476166,
      "rmse_dtheta": 0.02226950414478779,
      "rmse_dx": 0.0058770934119820595,
      "rmse_dy": 0.0053067198023200035,
      "rmse_mean": 0.011151107028126717,
      "rotation_flip": 0.0028694404754787683,
      "sparse_tokens": 32105.0,
      "step": 3181,
      "turn_loss": 0.09650910645723343,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.14783497491172645,
      "grad_norm": 0.34290608763694763,
      "learning_rate": 8.449438001787293e-06,
      "loss": 0.0674,
      "mae_dtheta": 0.00938302930444479,
      "mae_dx": 0.0016063896473497152,
      "mae_dy": 0.0016305164899677038,
      "pose_mae_dtheta": 0.06585510820150375,
      "pose_mae_dx": 0.018903836607933044,
      "pose_mae_dy": 0.022543294355273247,
      "pose_rmse_dtheta": 0.1833835244178772,
      "pose_rmse_dx": 0.058639753609895706,
      "pose_rmse_dy": 0.05450500175356865,
      "pose_rmse_mean": 0.09884276241064072,
      "rmse_dtheta": 0.023100057616829872,
      "rmse_dx": 0.005576719995588064,
      "rmse_dy": 0.003918747883290052,
      "rmse_mean": 0.01086517609655857,
      "rotation_flip": 0.00438116118311882,
      "sparse_tokens": 32041.0,
      "step": 3182,
      "turn_loss": 0.056306179612874985,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6197.0,
      "epoch": 0.14788143467756923,
      "grad_norm": 0.515555739402771,
      "learning_rate": 8.448480704942976e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.03595063462853432,
      "mae_dx": 0.009318750351667404,
      "mae_dy": 0.005053261760622263,
      "pose_mae_dtheta": 0.2875903248786926,
      "pose_mae_dx": 0.061662133783102036,
      "pose_mae_dy": 0.06221732869744301,
      "pose_rmse_dtheta": 0.5750371217727661,
      "pose_rmse_dx": 0.16098804771900177,
      "pose_rmse_dy": 0.19969314336776733,
      "pose_rmse_mean": 0.311906099319458,
      "rmse_dtheta": 0.059491854161024094,
      "rmse_dx": 0.021317891776561737,
      "rmse_dy": 0.011791450902819633,
      "rmse_mean": 0.030867066234350204,
      "rotation_flip": 0.003225806402042508,
      "sparse_tokens": 5405.0,
      "step": 3183,
      "turn_loss": 0.26190343499183655,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.147927894443412,
      "grad_norm": 0.5276576280593872,
      "learning_rate": 8.44752316694455e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.03620200231671333,
      "mae_dx": 0.010911506600677967,
      "mae_dy": 0.005289135035127401,
      "pose_mae_dtheta": 0.30151405930519104,
      "pose_mae_dx": 0.10319402813911438,
      "pose_mae_dy": 0.07208503782749176,
      "pose_rmse_dtheta": 0.5242965817451477,
      "pose_rmse_dx": 0.2244195193052292,
      "pose_rmse_dy": 0.17939655482769012,
      "pose_rmse_mean": 0.30937090516090393,
      "rmse_dtheta": 0.05516969785094261,
      "rmse_dx": 0.022885160520672798,
      "rmse_dy": 0.011872557923197746,
      "rmse_mean": 0.029975807294249535,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 14550.0,
      "step": 3184,
      "turn_loss": 0.2672509253025055,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.14797435420925478,
      "grad_norm": 0.5014019012451172,
      "learning_rate": 8.44656538785898e-06,
      "loss": 0.1318,
      "mae_dtheta": 0.032128844410181046,
      "mae_dx": 0.010922287590801716,
      "mae_dy": 0.005298397038131952,
      "pose_mae_dtheta": 0.2555851638317108,
      "pose_mae_dx": 0.08060947060585022,
      "pose_mae_dy": 0.040068138390779495,
      "pose_rmse_dtheta": 0.44866275787353516,
      "pose_rmse_dx": 0.1691223680973053,
      "pose_rmse_dy": 0.0778563991189003,
      "pose_rmse_mean": 0.23188051581382751,
      "rmse_dtheta": 0.052214596420526505,
      "rmse_dx": 0.020455561578273773,
      "rmse_dy": 0.011309169232845306,
      "rmse_mean": 0.027993110939860344,
      "rotation_flip": 0.01610017940402031,
      "sparse_tokens": 9101.0,
      "step": 3185,
      "turn_loss": 0.31999582052230835,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14802081397509756,
      "grad_norm": 0.427274227142334,
      "learning_rate": 8.445607367753245e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.009981614537537098,
      "mae_dx": 0.0014757667668163776,
      "mae_dy": 0.0021967338398098946,
      "pose_mae_dtheta": 0.07022387534379959,
      "pose_mae_dx": 0.02371639385819435,
      "pose_mae_dy": 0.03131818771362305,
      "pose_rmse_dtheta": 0.15574267506599426,
      "pose_rmse_dx": 0.060233790427446365,
      "pose_rmse_dy": 0.07374513894319534,
      "pose_rmse_mean": 0.09657387435436249,
      "rmse_dtheta": 0.02073817513883114,
      "rmse_dx": 0.004264021757990122,
      "rmse_dy": 0.004575446713715792,
      "rmse_mean": 0.009859214536845684,
      "rotation_flip": 0.0029093932826071978,
      "sparse_tokens": 32057.0,
      "step": 3186,
      "turn_loss": 0.07360242307186127,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14806727374094034,
      "grad_norm": 0.4652999937534332,
      "learning_rate": 8.444649106694335e-06,
      "loss": 0.1379,
      "mae_dtheta": 0.007594737224280834,
      "mae_dx": 0.003054915927350521,
      "mae_dy": 0.0014400511281564832,
      "pose_mae_dtheta": 0.05373859778046608,
      "pose_mae_dx": 0.03177228942513466,
      "pose_mae_dy": 0.02055809646844864,
      "pose_rmse_dtheta": 0.16663911938667297,
      "pose_rmse_dx": 0.10626126825809479,
      "pose_rmse_dy": 0.05613771453499794,
      "pose_rmse_mean": 0.10967937111854553,
      "rmse_dtheta": 0.019399050623178482,
      "rmse_dx": 0.010595645755529404,
      "rmse_dy": 0.0033944540191441774,
      "rmse_mean": 0.011129717342555523,
      "rotation_flip": 0.0028506270609796047,
      "sparse_tokens": 32073.0,
      "step": 3187,
      "turn_loss": 0.07848071306943893,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1481137335067831,
      "grad_norm": 0.4997132420539856,
      "learning_rate": 8.443690604749264e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.010710998438298702,
      "mae_dx": 0.0023565918672829866,
      "mae_dy": 0.002342967549338937,
      "pose_mae_dtheta": 0.0768197700381279,
      "pose_mae_dx": 0.025573190301656723,
      "pose_mae_dy": 0.028816595673561096,
      "pose_rmse_dtheta": 0.17151181399822235,
      "pose_rmse_dx": 0.0658583715558052,
      "pose_rmse_dy": 0.07619647681713104,
      "pose_rmse_mean": 0.1045222282409668,
      "rmse_dtheta": 0.02369374781847,
      "rmse_dx": 0.0064942436292767525,
      "rmse_dy": 0.005779628176242113,
      "rmse_mean": 0.011989206075668335,
      "rotation_flip": 0.008792049251496792,
      "sparse_tokens": 32169.0,
      "step": 3188,
      "turn_loss": 0.09325844049453735,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14816019327262592,
      "grad_norm": 0.6390448808670044,
      "learning_rate": 8.44273186198506e-06,
      "loss": 0.1448,
      "mae_dtheta": 0.012811833992600441,
      "mae_dx": 0.0024518275167793036,
      "mae_dy": 0.004486201796680689,
      "pose_mae_dtheta": 0.09334976226091385,
      "pose_mae_dx": 0.041546937078237534,
      "pose_mae_dy": 0.04957883059978485,
      "pose_rmse_dtheta": 0.1932743936777115,
      "pose_rmse_dx": 0.10398690402507782,
      "pose_rmse_dy": 0.12238546460866928,
      "pose_rmse_mean": 0.13988226652145386,
      "rmse_dtheta": 0.02310010977089405,
      "rmse_dx": 0.00598615687340498,
      "rmse_dy": 0.00910841766744852,
      "rmse_mean": 0.012731561437249184,
      "rotation_flip": 0.006818956695497036,
      "sparse_tokens": 32057.0,
      "step": 3189,
      "turn_loss": 0.12565763294696808,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1482066530384687,
      "grad_norm": 0.3194233179092407,
      "learning_rate": 8.44177287846877e-06,
      "loss": 0.0742,
      "mae_dtheta": 0.014576231129467487,
      "mae_dx": 0.0022795628756284714,
      "mae_dy": 0.0031747976318001747,
      "pose_mae_dtheta": 0.10042043775320053,
      "pose_mae_dx": 0.027042098343372345,
      "pose_mae_dy": 0.032456379383802414,
      "pose_rmse_dtheta": 0.24842232465744019,
      "pose_rmse_dx": 0.0650010034441948,
      "pose_rmse_dy": 0.06835532188415527,
      "pose_rmse_mean": 0.12725955247879028,
      "rmse_dtheta": 0.029197894036769867,
      "rmse_dx": 0.006527972873300314,
      "rmse_dy": 0.006409564521163702,
      "rmse_mean": 0.014045143499970436,
      "rotation_flip": 0.0074982959777116776,
      "sparse_tokens": 32121.0,
      "step": 3190,
      "turn_loss": 0.1127232238650322,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.14825311280431147,
      "grad_norm": 0.37473535537719727,
      "learning_rate": 8.440813654267455e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.04482302814722061,
      "mae_dx": 0.013548719696700573,
      "mae_dy": 0.004029678180813789,
      "pose_mae_dtheta": 0.3871366083621979,
      "pose_mae_dx": 0.10623574256896973,
      "pose_mae_dy": 0.06389297544956207,
      "pose_rmse_dtheta": 0.6326852440834045,
      "pose_rmse_dx": 0.23654158413410187,
      "pose_rmse_dy": 0.18760062754154205,
      "pose_rmse_mean": 0.3522758185863495,
      "rmse_dtheta": 0.06533579528331757,
      "rmse_dx": 0.02751002088189125,
      "rmse_dy": 0.008717414923012257,
      "rmse_mean": 0.0338544100522995,
      "rotation_flip": 0.0019762846641242504,
      "sparse_tokens": 8163.0,
      "step": 3191,
      "turn_loss": 0.2756086587905884,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.14829957257015425,
      "grad_norm": 0.5337039828300476,
      "learning_rate": 8.439854189448195e-06,
      "loss": 0.0726,
      "mae_dtheta": 0.010593577288091183,
      "mae_dx": 0.0026444655377417803,
      "mae_dy": 0.0028442705515772104,
      "pose_mae_dtheta": 0.08205069601535797,
      "pose_mae_dx": 0.021651500836014748,
      "pose_mae_dy": 0.0221050214022398,
      "pose_rmse_dtheta": 0.23973843455314636,
      "pose_rmse_dx": 0.05595644190907478,
      "pose_rmse_dy": 0.057082854211330414,
      "pose_rmse_mean": 0.11759258806705475,
      "rmse_dtheta": 0.027894387021660805,
      "rmse_dx": 0.008276643231511116,
      "rmse_dy": 0.008853604085743427,
      "rmse_mean": 0.015008211135864258,
      "rotation_flip": 0.0065876152366399765,
      "sparse_tokens": 32137.0,
      "step": 3192,
      "turn_loss": 0.09748107939958572,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.14834603233599702,
      "grad_norm": 0.4200207591056824,
      "learning_rate": 8.438894484078086e-06,
      "loss": 0.0964,
      "mae_dtheta": 0.009274191223084927,
      "mae_dx": 0.0022668628953397274,
      "mae_dy": 0.002281489549204707,
      "pose_mae_dtheta": 0.06346442550420761,
      "pose_mae_dx": 0.021115560084581375,
      "pose_mae_dy": 0.02080693282186985,
      "pose_rmse_dtheta": 0.16509036719799042,
      "pose_rmse_dx": 0.0766538679599762,
      "pose_rmse_dy": 0.05300470069050789,
      "pose_rmse_mean": 0.0982496440410614,
      "rmse_dtheta": 0.02242511324584484,
      "rmse_dx": 0.008139106445014477,
      "rmse_dy": 0.007515850476920605,
      "rmse_mean": 0.012693356722593307,
      "rotation_flip": 0.007363092619925737,
      "sparse_tokens": 32089.0,
      "step": 3193,
      "turn_loss": 0.10119644552469254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.1483924921018398,
      "grad_norm": 0.460580050945282,
      "learning_rate": 8.437934538224239e-06,
      "loss": 0.13,
      "mae_dtheta": 0.025455763563513756,
      "mae_dx": 0.009046699851751328,
      "mae_dy": 0.0031346699688583612,
      "pose_mae_dtheta": 0.2069137692451477,
      "pose_mae_dx": 0.06883376836776733,
      "pose_mae_dy": 0.04526669159531593,
      "pose_rmse_dtheta": 0.4705013334751129,
      "pose_rmse_dx": 0.18450428545475006,
      "pose_rmse_dy": 0.12157010287046432,
      "pose_rmse_mean": 0.2588585913181305,
      "rmse_dtheta": 0.04600729048252106,
      "rmse_dx": 0.022026970982551575,
      "rmse_dy": 0.006094372831285,
      "rmse_mean": 0.024709545075893402,
      "rotation_flip": 0.0033003301359713078,
      "sparse_tokens": 13413.0,
      "step": 3194,
      "turn_loss": 0.20057077705860138,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14843895186768258,
      "grad_norm": 0.5530887246131897,
      "learning_rate": 8.436974351953783e-06,
      "loss": 0.1877,
      "mae_dtheta": 0.008928216993808746,
      "mae_dx": 0.001575188827700913,
      "mae_dy": 0.0015651292633265257,
      "pose_mae_dtheta": 0.06220905855298042,
      "pose_mae_dx": 0.01717081479728222,
      "pose_mae_dy": 0.022345948964357376,
      "pose_rmse_dtheta": 0.1516815423965454,
      "pose_rmse_dx": 0.04200298711657524,
      "pose_rmse_dy": 0.05506514757871628,
      "pose_rmse_mean": 0.08291655778884888,
      "rmse_dtheta": 0.01991279050707817,
      "rmse_dx": 0.004878391977399588,
      "rmse_dy": 0.0031685440335422754,
      "rmse_mean": 0.009319908916950226,
      "rotation_flip": 0.0016856299480423331,
      "sparse_tokens": 32121.0,
      "step": 3195,
      "turn_loss": 0.07960766553878784,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.14848541163352535,
      "grad_norm": 0.5454937219619751,
      "learning_rate": 8.436013925333868e-06,
      "loss": 0.1661,
      "mae_dtheta": 0.025465505197644234,
      "mae_dx": 0.011146622709929943,
      "mae_dy": 0.004340308718383312,
      "pose_mae_dtheta": 0.19646449387073517,
      "pose_mae_dx": 0.09053495526313782,
      "pose_mae_dy": 0.06462124735116959,
      "pose_rmse_dtheta": 0.3733905851840973,
      "pose_rmse_dx": 0.2011464238166809,
      "pose_rmse_dy": 0.14240582287311554,
      "pose_rmse_mean": 0.2389809489250183,
      "rmse_dtheta": 0.042770810425281525,
      "rmse_dx": 0.02391703613102436,
      "rmse_dy": 0.007638696581125259,
      "rmse_mean": 0.024775516241788864,
      "rotation_flip": 0.012396694160997868,
      "sparse_tokens": 18435.0,
      "step": 3196,
      "turn_loss": 0.21931762993335724,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.14853187139936816,
      "grad_norm": 0.5551897287368774,
      "learning_rate": 8.435053258431654e-06,
      "loss": 0.1752,
      "mae_dtheta": 0.024493681266903877,
      "mae_dx": 0.011990908533334732,
      "mae_dy": 0.005008540116250515,
      "pose_mae_dtheta": 0.1790120154619217,
      "pose_mae_dx": 0.08809629827737808,
      "pose_mae_dy": 0.06338074803352356,
      "pose_rmse_dtheta": 0.3549634516239166,
      "pose_rmse_dx": 0.21158601343631744,
      "pose_rmse_dy": 0.14521926641464233,
      "pose_rmse_mean": 0.23725625872612,
      "rmse_dtheta": 0.03942832350730896,
      "rmse_dx": 0.025684406980872154,
      "rmse_dy": 0.008994834497570992,
      "rmse_mean": 0.0247025229036808,
      "rotation_flip": 0.007682458497583866,
      "sparse_tokens": 15886.0,
      "step": 3197,
      "turn_loss": 0.23528900742530823,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.14857833116521094,
      "grad_norm": 0.7821753025054932,
      "learning_rate": 8.43409235131432e-06,
      "loss": 0.2188,
      "mae_dtheta": 0.034730009734630585,
      "mae_dx": 0.00843862909823656,
      "mae_dy": 0.0038478875067085028,
      "pose_mae_dtheta": 0.2736184000968933,
      "pose_mae_dx": 0.06681771576404572,
      "pose_mae_dy": 0.050858233124017715,
      "pose_rmse_dtheta": 0.519742488861084,
      "pose_rmse_dx": 0.15415357053279877,
      "pose_rmse_dy": 0.13421837985515594,
      "pose_rmse_mean": 0.26937150955200195,
      "rmse_dtheta": 0.05622974410653114,
      "rmse_dx": 0.018969491124153137,
      "rmse_dy": 0.00782939326018095,
      "rmse_mean": 0.027676207944750786,
      "rotation_flip": 0.022448979318141937,
      "sparse_tokens": 8690.0,
      "step": 3198,
      "turn_loss": 0.20046988129615784,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1486247909310537,
      "grad_norm": 0.6903857588768005,
      "learning_rate": 8.433131204049067e-06,
      "loss": 0.2109,
      "mae_dtheta": 0.011623439379036427,
      "mae_dx": 0.00418655201792717,
      "mae_dy": 0.004261255729943514,
      "pose_mae_dtheta": 0.08846837282180786,
      "pose_mae_dx": 0.04952144995331764,
      "pose_mae_dy": 0.04573852941393852,
      "pose_rmse_dtheta": 0.19657942652702332,
      "pose_rmse_dx": 0.14144721627235413,
      "pose_rmse_dy": 0.1266329139471054,
      "pose_rmse_mean": 0.15488652884960175,
      "rmse_dtheta": 0.023824414238333702,
      "rmse_dx": 0.011489471420645714,
      "rmse_dy": 0.010609763674438,
      "rmse_mean": 0.015307883732020855,
      "rotation_flip": 0.0036390102468430996,
      "sparse_tokens": 32121.0,
      "step": 3199,
      "turn_loss": 0.12667123973369598,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35363.0,
      "epoch": 0.1486712506968965,
      "grad_norm": 1.0435057878494263,
      "learning_rate": 8.432169816703107e-06,
      "loss": 0.2929,
      "mae_dtheta": 0.03246321529150009,
      "mae_dx": 0.010541473515331745,
      "mae_dy": 0.004888479597866535,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.999998927116394,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.29844665527344,
      "model/head/act_norm_mean": 105.7002938646789,
      "model/head/act_norm_min": 58.305389404296875,
      "model/head/act_over_embed": 72.63823152554961,
      "model/head/grad_frac": 0.11610046774148941,
      "model/head/grad_norm": 0.11610034108161926,
      "model/head/grad_zero_frac": 0.00017735491564963013,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6846867832568807,
      "model/head/update_ratio": 0.0020019495859742165,
      "model/head/weight_delta": 6.631866931915283,
      "model/head/weight_delta_rel": 0.11634258925914764,
      "model/head/weight_norm": 57.9936408996582,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4163317084312439,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4162713484330611,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4162125587463379,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2860655678369649,
      "model/modality_embedder.encoders.pose/grad_frac": 0.073687344789505,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07368726283311844,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.526171875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0023899551015347242,
      "model/modality_embedder.encoders.pose/weight_delta": 2.1774377822875977,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07114367932081223,
      "model/modality_embedder.encoders.pose/weight_norm": 30.832069396972656,
      "model/modality_embedder/grad_frac": 0.073687344789505,
      "model/modality_embedder/grad_norm": 0.07368726283311844,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.526171875,
      "model/modality_embedder/update_ratio": 0.0023899551015347242,
      "model/modality_embedder/weight_delta": 2.1774377822875977,
      "model/modality_embedder/weight_delta_rel": 0.07114367932081223,
      "model/modality_embedder/weight_norm": 30.832069396972656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.58421325683594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.133086682685306,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.949830055236816,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.897273743711066,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.153549924492836,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.15354976058006287,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.005544353276491165,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.4759942293167114,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05378612130880356,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.694801330566406,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.08073425292969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.030428589631573,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.636517524719238,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.513935503211833,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.12723763287067413,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.1272374987602234,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.004339131526648998,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.8580197095870972,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0643632560968399,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.323265075683594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.60430908203125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.74334907892821,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.79126262664795,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.691070500070765,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.12174597382545471,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.12174583971500397,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.004022279754281044,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 1.9921377897262573,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06689225882291794,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.267868041992188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.28938293457031,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.669515436143875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.739763259887695,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.01475005380292,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12093932181596756,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.12093919515609741,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.004084430169314146,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.7001975774765015,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05810468643903732,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.60980987548828,
      "model/normalizer/grad_frac": 0.5260800123214722,
      "model/normalizer/grad_norm": 0.5260794758796692,
      "model/normalizer/grad_zero_frac": 0.00014062687114346772,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.006731147412210703,
      "model/normalizer/weight_delta": 3.617375373840332,
      "model/normalizer/weight_delta_rel": 0.046589698642492294,
      "model/normalizer/weight_norm": 78.15599060058594,
      "pose_mae_dtheta": 0.25251495838165283,
      "pose_mae_dx": 0.08197813481092453,
      "pose_mae_dy": 0.059277597814798355,
      "pose_rmse_dtheta": 0.45718395709991455,
      "pose_rmse_dx": 0.20530341565608978,
      "pose_rmse_dy": 0.14769712090492249,
      "pose_rmse_mean": 0.2700614929199219,
      "rmse_dtheta": 0.0524759478867054,
      "rmse_dx": 0.022799169644713402,
      "rmse_dy": 0.011934883892536163,
      "rmse_mean": 0.02907000109553337,
      "rotation_flip": 0.015197568573057652,
      "sparse_tokens": 27102.0,
      "step": 3200,
      "turn_loss": 0.26958468556404114,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "epoch": 0.1486712506968965,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31448498368263245,
      "eval_objectnav_nopose_mae_dtheta": 0.04109271988272667,
      "eval_objectnav_nopose_mae_dx": 0.013504769653081894,
      "eval_objectnav_nopose_mae_dy": 0.0051047056913375854,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.33359161019325256,
      "eval_objectnav_nopose_pose_mae_dx": 0.10997211933135986,
      "eval_objectnav_nopose_pose_mae_dy": 0.057103727012872696,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.556536853313446,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23641864955425262,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13394403457641602,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3089665174484253,
      "eval_objectnav_nopose_rmse_dtheta": 0.05897815153002739,
      "eval_objectnav_nopose_rmse_dx": 0.02614406682550907,
      "eval_objectnav_nopose_rmse_dy": 0.010433674789965153,
      "eval_objectnav_nopose_rmse_mean": 0.03185196593403816,
      "eval_objectnav_nopose_rotation_flip": 0.01647685468196869,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31448498368263245,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 3200
    },
    {
      "epoch": 0.1486712506968965,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28493890166282654,
      "eval_objectnav_pose_mae_dtheta": 0.03626231849193573,
      "eval_objectnav_pose_mae_dx": 0.011222565546631813,
      "eval_objectnav_pose_mae_dy": 0.00482261972501874,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27994683384895325,
      "eval_objectnav_pose_pose_mae_dx": 0.09120623022317886,
      "eval_objectnav_pose_pose_mae_dy": 0.05069904401898384,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4850596487522125,
      "eval_objectnav_pose_pose_rmse_dx": 0.2066444307565689,
      "eval_objectnav_pose_pose_rmse_dy": 0.1217198446393013,
      "eval_objectnav_pose_pose_rmse_mean": 0.27114132046699524,
      "eval_objectnav_pose_rmse_dtheta": 0.05399920046329498,
      "eval_objectnav_pose_rmse_dx": 0.02327670529484749,
      "eval_objectnav_pose_rmse_dy": 0.01008653361350298,
      "eval_objectnav_pose_rmse_mean": 0.02912081405520439,
      "eval_objectnav_pose_rotation_flip": 0.014492470771074295,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28493890166282654,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 3200
    },
    {
      "epoch": 0.1486712506968965,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10150580108165741,
      "eval_pointnav_mae_dtheta": 0.01199785340577364,
      "eval_pointnav_mae_dx": 0.002808983437716961,
      "eval_pointnav_mae_dy": 0.0029665271285921335,
      "eval_pointnav_pose_mae_dtheta": 0.08648883551359177,
      "eval_pointnav_pose_mae_dx": 0.03211258351802826,
      "eval_pointnav_pose_mae_dy": 0.03260321170091629,
      "eval_pointnav_pose_rmse_dtheta": 0.22960853576660156,
      "eval_pointnav_pose_rmse_dx": 0.09064111858606339,
      "eval_pointnav_pose_rmse_dy": 0.09340149164199829,
      "eval_pointnav_pose_rmse_mean": 0.137883722782135,
      "eval_pointnav_rmse_dtheta": 0.02762920781970024,
      "eval_pointnav_rmse_dx": 0.00835235696285963,
      "eval_pointnav_rmse_dy": 0.00766361877322197,
      "eval_pointnav_rmse_mean": 0.014548394829034805,
      "eval_pointnav_rotation_flip": 0.005596357397735119,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10150580108165741,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 3200
    },
    {
      "epoch": 0.1486712506968965,
      "eval_loss": 0.2336432288090388,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31448498368263245,
      "eval_objectnav_nopose_mae_dtheta": 0.04109271988272667,
      "eval_objectnav_nopose_mae_dx": 0.013504769653081894,
      "eval_objectnav_nopose_mae_dy": 0.0051047056913375854,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.33359161019325256,
      "eval_objectnav_nopose_pose_mae_dx": 0.10997211933135986,
      "eval_objectnav_nopose_pose_mae_dy": 0.057103727012872696,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.556536853313446,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23641864955425262,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13394403457641602,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3089665174484253,
      "eval_objectnav_nopose_rmse_dtheta": 0.05897815153002739,
      "eval_objectnav_nopose_rmse_dx": 0.02614406682550907,
      "eval_objectnav_nopose_rmse_dy": 0.010433674789965153,
      "eval_objectnav_nopose_rmse_mean": 0.03185196593403816,
      "eval_objectnav_nopose_rotation_flip": 0.01647685468196869,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31448498368263245,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28493890166282654,
      "eval_objectnav_pose_mae_dtheta": 0.03626231849193573,
      "eval_objectnav_pose_mae_dx": 0.011222565546631813,
      "eval_objectnav_pose_mae_dy": 0.00482261972501874,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27994683384895325,
      "eval_objectnav_pose_pose_mae_dx": 0.09120623022317886,
      "eval_objectnav_pose_pose_mae_dy": 0.05069904401898384,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4850596487522125,
      "eval_objectnav_pose_pose_rmse_dx": 0.2066444307565689,
      "eval_objectnav_pose_pose_rmse_dy": 0.1217198446393013,
      "eval_objectnav_pose_pose_rmse_mean": 0.27114132046699524,
      "eval_objectnav_pose_rmse_dtheta": 0.05399920046329498,
      "eval_objectnav_pose_rmse_dx": 0.02327670529484749,
      "eval_objectnav_pose_rmse_dy": 0.01008653361350298,
      "eval_objectnav_pose_rmse_mean": 0.02912081405520439,
      "eval_objectnav_pose_rotation_flip": 0.014492470771074295,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28493890166282654,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10150580108165741,
      "eval_pointnav_mae_dtheta": 0.01199785340577364,
      "eval_pointnav_mae_dx": 0.002808983437716961,
      "eval_pointnav_mae_dy": 0.0029665271285921335,
      "eval_pointnav_pose_mae_dtheta": 0.08648883551359177,
      "eval_pointnav_pose_mae_dx": 0.03211258351802826,
      "eval_pointnav_pose_mae_dy": 0.03260321170091629,
      "eval_pointnav_pose_rmse_dtheta": 0.22960853576660156,
      "eval_pointnav_pose_rmse_dx": 0.09064111858606339,
      "eval_pointnav_pose_rmse_dy": 0.09340149164199829,
      "eval_pointnav_pose_rmse_mean": 0.137883722782135,
      "eval_pointnav_rmse_dtheta": 0.02762920781970024,
      "eval_pointnav_rmse_dx": 0.00835235696285963,
      "eval_pointnav_rmse_dy": 0.00766361877322197,
      "eval_pointnav_rmse_mean": 0.014548394829034805,
      "eval_pointnav_rotation_flip": 0.005596357397735119,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10150580108165741,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 3200
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14871771046273927,
      "grad_norm": 0.6565958857536316,
      "learning_rate": 8.43120818934367e-06,
      "loss": 0.1584,
      "mae_dtheta": 0.008822506293654442,
      "mae_dx": 0.0020982669666409492,
      "mae_dy": 0.0025889661628752947,
      "pose_mae_dtheta": 0.06356587260961533,
      "pose_mae_dx": 0.028835050761699677,
      "pose_mae_dy": 0.02948945388197899,
      "pose_rmse_dtheta": 0.13926126062870026,
      "pose_rmse_dx": 0.08074263483285904,
      "pose_rmse_dy": 0.07941868901252747,
      "pose_rmse_mean": 0.09980753064155579,
      "rmse_dtheta": 0.01949784718453884,
      "rmse_dx": 0.006872429512441158,
      "rmse_dy": 0.006297514773905277,
      "rmse_mean": 0.010889263823628426,
      "rotation_flip": 0.004520795773714781,
      "sparse_tokens": 32057.0,
      "step": 3201,
      "turn_loss": 0.0756232813000679,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.14876417022858204,
      "grad_norm": 0.4325966536998749,
      "learning_rate": 8.430246322038e-06,
      "loss": 0.0944,
      "mae_dtheta": 0.008462934754788876,
      "mae_dx": 0.0015601328341290355,
      "mae_dy": 0.0010445418301969767,
      "pose_mae_dtheta": 0.06744817644357681,
      "pose_mae_dx": 0.017118722200393677,
      "pose_mae_dy": 0.016870791092514992,
      "pose_rmse_dtheta": 0.2503748834133148,
      "pose_rmse_dx": 0.0444549135863781,
      "pose_rmse_dy": 0.0492369644343853,
      "pose_rmse_mean": 0.1146889179944992,
      "rmse_dtheta": 0.02603820711374283,
      "rmse_dx": 0.004404131323099136,
      "rmse_dy": 0.0026712031103670597,
      "rmse_mean": 0.011037847958505154,
      "rotation_flip": 0.005780346691608429,
      "sparse_tokens": 32137.0,
      "step": 3202,
      "turn_loss": 0.056773558259010315,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18773.0,
      "epoch": 0.14881062999442482,
      "grad_norm": 0.594499409198761,
      "learning_rate": 8.429284214853363e-06,
      "loss": 0.1595,
      "mae_dtheta": 0.0371381938457489,
      "mae_dx": 0.011156141757965088,
      "mae_dy": 0.005384450312703848,
      "pose_mae_dtheta": 0.3025457262992859,
      "pose_mae_dx": 0.10102022439241409,
      "pose_mae_dy": 0.07228556275367737,
      "pose_rmse_dtheta": 0.5337150692939758,
      "pose_rmse_dx": 0.2368892878293991,
      "pose_rmse_dy": 0.1683799773454666,
      "pose_rmse_mean": 0.3129947781562805,
      "rmse_dtheta": 0.055042609572410583,
      "rmse_dx": 0.024492787197232246,
      "rmse_dy": 0.009298412129282951,
      "rmse_mean": 0.029611270874738693,
      "rotation_flip": 0.01295896340161562,
      "sparse_tokens": 15923.0,
      "step": 3203,
      "turn_loss": 0.27178502082824707,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.1488570897602676,
      "grad_norm": 0.7410398721694946,
      "learning_rate": 8.428321867857043e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.023653224110603333,
      "mae_dx": 0.011815706267952919,
      "mae_dy": 0.0048148720525205135,
      "pose_mae_dtheta": 0.16355572640895844,
      "pose_mae_dx": 0.09122591465711594,
      "pose_mae_dy": 0.049113672226667404,
      "pose_rmse_dtheta": 0.3777642548084259,
      "pose_rmse_dx": 0.20362305641174316,
      "pose_rmse_dy": 0.11799561232328415,
      "pose_rmse_mean": 0.2331276386976242,
      "rmse_dtheta": 0.041491519659757614,
      "rmse_dx": 0.023558126762509346,
      "rmse_dy": 0.009445613250136375,
      "rmse_mean": 0.024831755086779594,
      "rotation_flip": 0.010893246158957481,
      "sparse_tokens": 9418.0,
      "step": 3204,
      "turn_loss": 0.1554868221282959,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1489035495261104,
      "grad_norm": 0.7611187100410461,
      "learning_rate": 8.427359281116335e-06,
      "loss": 0.1478,
      "mae_dtheta": 0.005600740667432547,
      "mae_dx": 0.0012006292818114161,
      "mae_dy": 0.0011011766036972404,
      "pose_mae_dtheta": 0.037495288997888565,
      "pose_mae_dx": 0.012069710530340672,
      "pose_mae_dy": 0.014884566888213158,
      "pose_rmse_dtheta": 0.07659123837947845,
      "pose_rmse_dx": 0.029933156445622444,
      "pose_rmse_dy": 0.03855000436306,
      "pose_rmse_mean": 0.04835813492536545,
      "rmse_dtheta": 0.013377704657614231,
      "rmse_dx": 0.003705109702423215,
      "rmse_dy": 0.002341985935345292,
      "rmse_mean": 0.006474933587014675,
      "rotation_flip": 0.0029254022520035505,
      "sparse_tokens": 32137.0,
      "step": 3205,
      "turn_loss": 0.045073240995407104,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.14895000929195318,
      "grad_norm": 0.5726857781410217,
      "learning_rate": 8.426396454698552e-06,
      "loss": 0.1293,
      "mae_dtheta": 0.010385236702859402,
      "mae_dx": 0.0022194762714207172,
      "mae_dy": 0.0025801737792789936,
      "pose_mae_dtheta": 0.07900001853704453,
      "pose_mae_dx": 0.024138323962688446,
      "pose_mae_dy": 0.027153611183166504,
      "pose_rmse_dtheta": 0.21563930809497833,
      "pose_rmse_dx": 0.060073405504226685,
      "pose_rmse_dy": 0.06669162213802338,
      "pose_rmse_mean": 0.1141347885131836,
      "rmse_dtheta": 0.024909792467951775,
      "rmse_dx": 0.0064679887145757675,
      "rmse_dy": 0.006599655840545893,
      "rmse_mean": 0.012659146450459957,
      "rotation_flip": 0.002862985711544752,
      "sparse_tokens": 32153.0,
      "step": 3206,
      "turn_loss": 0.09845874458551407,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.14899646905779595,
      "grad_norm": 0.5599086284637451,
      "learning_rate": 8.425433388671025e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.010717267170548439,
      "mae_dx": 0.002560231601819396,
      "mae_dy": 0.0027126711793243885,
      "pose_mae_dtheta": 0.07513756304979324,
      "pose_mae_dx": 0.02921762317419052,
      "pose_mae_dy": 0.029337499290704727,
      "pose_rmse_dtheta": 0.16433724761009216,
      "pose_rmse_dx": 0.07845688611268997,
      "pose_rmse_dy": 0.0720263347029686,
      "pose_rmse_mean": 0.10494016110897064,
      "rmse_dtheta": 0.022236434742808342,
      "rmse_dx": 0.007784415502101183,
      "rmse_dy": 0.0065350825898349285,
      "rmse_mean": 0.012185310944914818,
      "rotation_flip": 0.006439393851906061,
      "sparse_tokens": 32137.0,
      "step": 3207,
      "turn_loss": 0.09800444543361664,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29755.0,
      "epoch": 0.14904292882363873,
      "grad_norm": 0.815466582775116,
      "learning_rate": 8.424470083101101e-06,
      "loss": 0.2058,
      "mae_dtheta": 0.03851774334907532,
      "mae_dx": 0.015489772893488407,
      "mae_dy": 0.007251767907291651,
      "pose_mae_dtheta": 0.3010752201080322,
      "pose_mae_dx": 0.11791028827428818,
      "pose_mae_dy": 0.08386500924825668,
      "pose_rmse_dtheta": 0.5086629986763,
      "pose_rmse_dx": 0.26519230008125305,
      "pose_rmse_dy": 0.23741546273231506,
      "pose_rmse_mean": 0.33709025382995605,
      "rmse_dtheta": 0.05617152899503708,
      "rmse_dx": 0.029796821996569633,
      "rmse_dy": 0.017616188153624535,
      "rmse_mean": 0.034528180956840515,
      "rotation_flip": 0.017463933676481247,
      "sparse_tokens": 22016.0,
      "step": 3208,
      "turn_loss": 0.37733545899391174,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.1490893885894815,
      "grad_norm": 1.007508635520935,
      "learning_rate": 8.42350653805615e-06,
      "loss": 0.284,
      "mae_dtheta": 0.04271978512406349,
      "mae_dx": 0.01642506942152977,
      "mae_dy": 0.009691433981060982,
      "pose_mae_dtheta": 0.32803085446357727,
      "pose_mae_dx": 0.14514678716659546,
      "pose_mae_dy": 0.08682826906442642,
      "pose_rmse_dtheta": 0.5481096506118774,
      "pose_rmse_dx": 0.30421891808509827,
      "pose_rmse_dy": 0.222490593791008,
      "pose_rmse_mean": 0.3582730293273926,
      "rmse_dtheta": 0.062134988605976105,
      "rmse_dx": 0.02954915165901184,
      "rmse_dy": 0.02123899571597576,
      "rmse_mean": 0.037641048431396484,
      "rotation_flip": 0.02301255241036415,
      "sparse_tokens": 7362.0,
      "step": 3209,
      "turn_loss": 0.3733787536621094,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 30723.0,
      "epoch": 0.14913584835532429,
      "grad_norm": 0.84608393907547,
      "learning_rate": 8.422542753603547e-06,
      "loss": 0.1357,
      "mae_dtheta": 0.045299232006073,
      "mae_dx": 0.016010452061891556,
      "mae_dy": 0.00764826312661171,
      "pose_mae_dtheta": 0.3805319666862488,
      "pose_mae_dx": 0.12790937721729279,
      "pose_mae_dy": 0.08479506522417068,
      "pose_rmse_dtheta": 0.6183962821960449,
      "pose_rmse_dx": 0.2649359107017517,
      "pose_rmse_dy": 0.22329720854759216,
      "pose_rmse_mean": 0.36887645721435547,
      "rmse_dtheta": 0.0633912906050682,
      "rmse_dx": 0.02814575843513012,
      "rmse_dy": 0.016621550545096397,
      "rmse_mean": 0.03605286777019501,
      "rotation_flip": 0.013670540414750576,
      "sparse_tokens": 22154.0,
      "step": 3210,
      "turn_loss": 0.38624951243400574,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.14918230812116706,
      "grad_norm": 0.649230420589447,
      "learning_rate": 8.421578729810693e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.04248478636145592,
      "mae_dx": 0.011017406359314919,
      "mae_dy": 0.010759221389889717,
      "pose_mae_dtheta": 0.32712334394454956,
      "pose_mae_dx": 0.10265939682722092,
      "pose_mae_dy": 0.10840648412704468,
      "pose_rmse_dtheta": 0.5224000215530396,
      "pose_rmse_dx": 0.22902269661426544,
      "pose_rmse_dy": 0.20796042680740356,
      "pose_rmse_mean": 0.3197943866252899,
      "rmse_dtheta": 0.05961393564939499,
      "rmse_dx": 0.02287333644926548,
      "rmse_dy": 0.018402520567178726,
      "rmse_mean": 0.03362993150949478,
      "rotation_flip": 0.015118790790438652,
      "sparse_tokens": 7464.0,
      "step": 3211,
      "turn_loss": 0.429198294878006,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.14922876788700984,
      "grad_norm": 0.503477931022644,
      "learning_rate": 8.420614466745e-06,
      "loss": 0.1164,
      "mae_dtheta": 0.011707277037203312,
      "mae_dx": 0.0024656730238348246,
      "mae_dy": 0.003291651839390397,
      "pose_mae_dtheta": 0.07727020978927612,
      "pose_mae_dx": 0.03428085148334503,
      "pose_mae_dy": 0.03724679350852966,
      "pose_rmse_dtheta": 0.1563107669353485,
      "pose_rmse_dx": 0.10444444417953491,
      "pose_rmse_dy": 0.07997027039527893,
      "pose_rmse_mean": 0.11357516050338745,
      "rmse_dtheta": 0.02277481183409691,
      "rmse_dx": 0.007919689640402794,
      "rmse_dy": 0.007270246744155884,
      "rmse_mean": 0.012654915452003479,
      "rotation_flip": 0.004004805814474821,
      "sparse_tokens": 32057.0,
      "step": 3212,
      "turn_loss": 0.08935543149709702,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.14927522765285264,
      "grad_norm": 0.7518104910850525,
      "learning_rate": 8.419649964473903e-06,
      "loss": 0.1359,
      "mae_dtheta": 0.0331612266600132,
      "mae_dx": 0.012868436984717846,
      "mae_dy": 0.004861877299845219,
      "pose_mae_dtheta": 0.2682044208049774,
      "pose_mae_dx": 0.12201740592718124,
      "pose_mae_dy": 0.0771552249789238,
      "pose_rmse_dtheta": 0.4611596167087555,
      "pose_rmse_dx": 0.27570897340774536,
      "pose_rmse_dy": 0.13317880034446716,
      "pose_rmse_mean": 0.2900158166885376,
      "rmse_dtheta": 0.04886181280016899,
      "rmse_dx": 0.02639637514948845,
      "rmse_dy": 0.007019005250185728,
      "rmse_mean": 0.02742573246359825,
      "rotation_flip": 0.011627906933426857,
      "sparse_tokens": 4416.0,
      "step": 3213,
      "turn_loss": 0.2802732586860657,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14932168741869542,
      "grad_norm": 0.5905011296272278,
      "learning_rate": 8.418685223064848e-06,
      "loss": 0.112,
      "mae_dtheta": 0.01286118570715189,
      "mae_dx": 0.0036306525580585003,
      "mae_dy": 0.005229665897786617,
      "pose_mae_dtheta": 0.09373977780342102,
      "pose_mae_dx": 0.03453781083226204,
      "pose_mae_dy": 0.04198845475912094,
      "pose_rmse_dtheta": 0.2378605455160141,
      "pose_rmse_dx": 0.098738893866539,
      "pose_rmse_dy": 0.12144211679697037,
      "pose_rmse_mean": 0.15268051624298096,
      "rmse_dtheta": 0.028453679755330086,
      "rmse_dx": 0.009585871361196041,
      "rmse_dy": 0.013437934219837189,
      "rmse_mean": 0.01715916208922863,
      "rotation_flip": 0.007314099930226803,
      "sparse_tokens": 32105.0,
      "step": 3214,
      "turn_loss": 0.14529967308044434,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.1493681471845382,
      "grad_norm": 0.7458109855651855,
      "learning_rate": 8.417720242585302e-06,
      "loss": 0.1989,
      "mae_dtheta": 0.048985835164785385,
      "mae_dx": 0.008688725531101227,
      "mae_dy": 0.006389951799064875,
      "pose_mae_dtheta": 0.42047780752182007,
      "pose_mae_dx": 0.05878780037164688,
      "pose_mae_dy": 0.09437599033117294,
      "pose_rmse_dtheta": 0.6240721940994263,
      "pose_rmse_dx": 0.13053768873214722,
      "pose_rmse_dy": 0.2663213610649109,
      "pose_rmse_mean": 0.3403104245662689,
      "rmse_dtheta": 0.06577980518341064,
      "rmse_dx": 0.019366441294550896,
      "rmse_dy": 0.014361824840307236,
      "rmse_mean": 0.03316935896873474,
      "rotation_flip": 0.010273972526192665,
      "sparse_tokens": 4861.0,
      "step": 3215,
      "turn_loss": 0.34334492683410645,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14941460695038097,
      "grad_norm": 0.5749719738960266,
      "learning_rate": 8.416755023102743e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.009718161076307297,
      "mae_dx": 0.0012412142241373658,
      "mae_dy": 0.0018204463412985206,
      "pose_mae_dtheta": 0.0696166381239891,
      "pose_mae_dx": 0.01932586170732975,
      "pose_mae_dy": 0.025613045319914818,
      "pose_rmse_dtheta": 0.21128857135772705,
      "pose_rmse_dx": 0.05038182809948921,
      "pose_rmse_dy": 0.06199271231889725,
      "pose_rmse_mean": 0.10788770765066147,
      "rmse_dtheta": 0.022988807410001755,
      "rmse_dx": 0.0033244567457586527,
      "rmse_dy": 0.003911016043275595,
      "rmse_mean": 0.010074760764837265,
      "rotation_flip": 0.0052770450711250305,
      "sparse_tokens": 32073.0,
      "step": 3216,
      "turn_loss": 0.07464167475700378,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14946106671622375,
      "grad_norm": 0.7031800746917725,
      "learning_rate": 8.415789564684673e-06,
      "loss": 0.0959,
      "mae_dtheta": 0.01038751658052206,
      "mae_dx": 0.0025300863198935986,
      "mae_dy": 0.0016842446057125926,
      "pose_mae_dtheta": 0.07820307463407516,
      "pose_mae_dx": 0.027832703664898872,
      "pose_mae_dy": 0.023488955572247505,
      "pose_rmse_dtheta": 0.23534610867500305,
      "pose_rmse_dx": 0.08183979988098145,
      "pose_rmse_dy": 0.0757761225104332,
      "pose_rmse_mean": 0.13098734617233276,
      "rmse_dtheta": 0.026736941188573837,
      "rmse_dx": 0.00826386921107769,
      "rmse_dy": 0.004699322395026684,
      "rmse_mean": 0.01323337759822607,
      "rotation_flip": 0.006900517735630274,
      "sparse_tokens": 32121.0,
      "step": 3217,
      "turn_loss": 0.08198120445013046,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.14950752648206653,
      "grad_norm": 0.6713539361953735,
      "learning_rate": 8.414823867398605e-06,
      "loss": 0.196,
      "mae_dtheta": 0.010288399644196033,
      "mae_dx": 0.0021677331533282995,
      "mae_dy": 0.002273155841976404,
      "pose_mae_dtheta": 0.07284583151340485,
      "pose_mae_dx": 0.023562796413898468,
      "pose_mae_dy": 0.028970304876565933,
      "pose_rmse_dtheta": 0.17818307876586914,
      "pose_rmse_dx": 0.07438713312149048,
      "pose_rmse_dy": 0.07384355366230011,
      "pose_rmse_mean": 0.10880458354949951,
      "rmse_dtheta": 0.02375371940433979,
      "rmse_dx": 0.007767018396407366,
      "rmse_dy": 0.006000950932502747,
      "rmse_mean": 0.012507230043411255,
      "rotation_flip": 0.007139857392758131,
      "sparse_tokens": 32105.0,
      "step": 3218,
      "turn_loss": 0.08912186324596405,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1495539862479093,
      "grad_norm": 0.8481456637382507,
      "learning_rate": 8.41385793131207e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.009295975789427757,
      "mae_dx": 0.0022624917328357697,
      "mae_dy": 0.0015745552955195308,
      "pose_mae_dtheta": 0.07184044271707535,
      "pose_mae_dx": 0.02576533704996109,
      "pose_mae_dy": 0.025171997025609016,
      "pose_rmse_dtheta": 0.1903143674135208,
      "pose_rmse_dx": 0.07116515189409256,
      "pose_rmse_dy": 0.06289473921060562,
      "pose_rmse_mean": 0.1081247553229332,
      "rmse_dtheta": 0.02183563821017742,
      "rmse_dx": 0.00689301360398531,
      "rmse_dy": 0.00329657387919724,
      "rmse_mean": 0.010675075463950634,
      "rotation_flip": 0.004383828490972519,
      "sparse_tokens": 32089.0,
      "step": 3219,
      "turn_loss": 0.07035204023122787,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.14960044601375208,
      "grad_norm": 0.6598479151725769,
      "learning_rate": 8.412891756492619e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.03146938234567642,
      "mae_dx": 0.016839290037751198,
      "mae_dy": 0.003141518449410796,
      "pose_mae_dtheta": 0.27535492181777954,
      "pose_mae_dx": 0.13286010921001434,
      "pose_mae_dy": 0.053568076342344284,
      "pose_rmse_dtheta": 0.530328094959259,
      "pose_rmse_dx": 0.2769017815589905,
      "pose_rmse_dy": 0.1444292664527893,
      "pose_rmse_mean": 0.31721973419189453,
      "rmse_dtheta": 0.052940208464860916,
      "rmse_dx": 0.031022246927022934,
      "rmse_dy": 0.0069414591416716576,
      "rmse_mean": 0.030301306396722794,
      "rotation_flip": 0.006493506487458944,
      "sparse_tokens": 2700.0,
      "step": 3220,
      "turn_loss": 0.2551962733268738,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.14964690577959486,
      "grad_norm": 0.6212165951728821,
      "learning_rate": 8.411925343007815e-06,
      "loss": 0.1652,
      "mae_dtheta": 0.014723360538482666,
      "mae_dx": 0.0021889943163841963,
      "mae_dy": 0.0039236415177583694,
      "pose_mae_dtheta": 0.10471513122320175,
      "pose_mae_dx": 0.03986148536205292,
      "pose_mae_dy": 0.05555148795247078,
      "pose_rmse_dtheta": 0.2166348695755005,
      "pose_rmse_dx": 0.09158016741275787,
      "pose_rmse_dy": 0.14993852376937866,
      "pose_rmse_mean": 0.15271785855293274,
      "rmse_dtheta": 0.026548264548182487,
      "rmse_dx": 0.005725599825382233,
      "rmse_dy": 0.008031679317355156,
      "rmse_mean": 0.013435183092951775,
      "rotation_flip": 0.008763059973716736,
      "sparse_tokens": 32089.0,
      "step": 3221,
      "turn_loss": 0.1220969557762146,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.14969336554543766,
      "grad_norm": 0.6889792680740356,
      "learning_rate": 8.410958690925239e-06,
      "loss": 0.1283,
      "mae_dtheta": 0.040370769798755646,
      "mae_dx": 0.008781631477177143,
      "mae_dy": 0.002416694536805153,
      "pose_mae_dtheta": 0.305228054523468,
      "pose_mae_dx": 0.057024989277124405,
      "pose_mae_dy": 0.03981241583824158,
      "pose_rmse_dtheta": 0.5798133015632629,
      "pose_rmse_dx": 0.16167287528514862,
      "pose_rmse_dy": 0.104934923350811,
      "pose_rmse_mean": 0.2821403741836548,
      "rmse_dtheta": 0.06295386701822281,
      "rmse_dx": 0.021779071539640427,
      "rmse_dy": 0.005497346166521311,
      "rmse_mean": 0.030076760798692703,
      "rotation_flip": 0.02184087410569191,
      "sparse_tokens": 10884.0,
      "step": 3222,
      "turn_loss": 0.29148104786872864,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.14973982531128044,
      "grad_norm": 0.9767244458198547,
      "learning_rate": 8.409991800312493e-06,
      "loss": 0.306,
      "mae_dtheta": 0.04621296375989914,
      "mae_dx": 0.00875843409448862,
      "mae_dy": 0.008532236330211163,
      "pose_mae_dtheta": 0.42793750762939453,
      "pose_mae_dx": 0.08487144112586975,
      "pose_mae_dy": 0.0926394984126091,
      "pose_rmse_dtheta": 0.6845749616622925,
      "pose_rmse_dx": 0.17517149448394775,
      "pose_rmse_dy": 0.18565984070301056,
      "pose_rmse_mean": 0.3484687805175781,
      "rmse_dtheta": 0.06604067236185074,
      "rmse_dx": 0.020315982401371002,
      "rmse_dy": 0.014232393354177475,
      "rmse_mean": 0.03352968394756317,
      "rotation_flip": 0.004048583097755909,
      "sparse_tokens": 4475.0,
      "step": 3223,
      "turn_loss": 0.43486881256103516,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.14978628507712322,
      "grad_norm": 0.6230295896530151,
      "learning_rate": 8.40902467123719e-06,
      "loss": 0.1214,
      "mae_dtheta": 0.029621588066220284,
      "mae_dx": 0.011388009414076805,
      "mae_dy": 0.0027976552955806255,
      "pose_mae_dtheta": 0.23656432330608368,
      "pose_mae_dx": 0.10105817019939423,
      "pose_mae_dy": 0.0305071659386158,
      "pose_rmse_dtheta": 0.3931005299091339,
      "pose_rmse_dx": 0.2172754555940628,
      "pose_rmse_dy": 0.06843294948339462,
      "pose_rmse_mean": 0.2262696474790573,
      "rmse_dtheta": 0.04586372524499893,
      "rmse_dx": 0.022865639999508858,
      "rmse_dy": 0.0052247922867536545,
      "rmse_mean": 0.024651385843753815,
      "rotation_flip": 0.015597919933497906,
      "sparse_tokens": 10821.0,
      "step": 3224,
      "turn_loss": 0.269092321395874,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.149832744842966,
      "grad_norm": 0.5762790441513062,
      "learning_rate": 8.408057303766961e-06,
      "loss": 0.1677,
      "mae_dtheta": 0.03806911036372185,
      "mae_dx": 0.018141405656933784,
      "mae_dy": 0.007600119337439537,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5762791037559509,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.15602111816406,
      "model/head/act_norm_mean": 100.91237386067708,
      "model/head/act_norm_min": 74.8145523071289,
      "model/head/act_over_embed": 69.34792807358626,
      "model/head/grad_frac": 0.11819787323474884,
      "model/head/grad_norm": 0.06811496615409851,
      "model/head/grad_zero_frac": 0.0001583186094649136,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6903211805555556,
      "model/head/update_ratio": 0.0011743884533643723,
      "model/head/weight_delta": 6.666152000427246,
      "model/head/weight_delta_rel": 0.11694405227899551,
      "model/head/weight_norm": 58.00037384033203,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41645702719688416,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41645702719688416,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41645702719688416,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2861931680218161,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05606760084629059,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03231058642268181,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010478794574737549,
      "model/modality_embedder.encoders.pose/weight_delta": 2.1868736743927,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07145197689533234,
      "model/modality_embedder.encoders.pose/weight_norm": 30.834259033203125,
      "model/modality_embedder/grad_frac": 0.05606760084629059,
      "model/modality_embedder/grad_norm": 0.03231058642268181,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0010478794574737549,
      "model/modality_embedder/weight_delta": 2.1868736743927,
      "model/modality_embedder/weight_delta_rel": 0.07145197689533234,
      "model/modality_embedder/weight_norm": 30.834259033203125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 69.87129974365234,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.60991753472222,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.228034019470215,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.537747007244102,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10025551170110703,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05777515470981598,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020859914366155863,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.485652208328247,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05413806438446045,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.696735382080078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 70.66354370117188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.447386188271604,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.965245246887207,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.1132633064683,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0997435674071312,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.057480134069919586,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001959990942850709,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.8714566230773926,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06482872366905212,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.32673454284668,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 72.57763671875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.072704819775133,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.352906227111816,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.230197486510296,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10387208312749863,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05985931307077408,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019774397369474173,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.006312847137451,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06736823171377182,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.271120071411133,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 72.9331283569336,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.0099964175485,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.213290214538574,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.56152240970985,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12746942043304443,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07345796376466751,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002480744384229183,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.71132493019104,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.058484964072704315,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.61125946044922,
      "model/normalizer/grad_frac": 0.5077857375144958,
      "model/normalizer/grad_norm": 0.2926263213157654,
      "model/normalizer/grad_zero_frac": 0.00015835295198485255,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0037439726293087006,
      "model/normalizer/weight_delta": 3.6422336101531982,
      "model/normalizer/weight_delta_rel": 0.04690986126661301,
      "model/normalizer/weight_norm": 78.15930938720703,
      "pose_mae_dtheta": 0.29976946115493774,
      "pose_mae_dx": 0.14351147413253784,
      "pose_mae_dy": 0.0845443606376648,
      "pose_rmse_dtheta": 0.46523532271385193,
      "pose_rmse_dx": 0.25907784700393677,
      "pose_rmse_dy": 0.1553523689508438,
      "pose_rmse_mean": 0.2932218313217163,
      "rmse_dtheta": 0.053341761231422424,
      "rmse_dx": 0.02903745509684086,
      "rmse_dy": 0.013286538422107697,
      "rmse_mean": 0.03188858553767204,
      "rotation_flip": 0.007042253389954567,
      "sparse_tokens": 4778.0,
      "step": 3225,
      "turn_loss": 0.4494982957839966,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.14987920460880877,
      "grad_norm": 0.6553444862365723,
      "learning_rate": 8.407089697969458e-06,
      "loss": 0.1453,
      "mae_dtheta": 0.020602069795131683,
      "mae_dx": 0.014056733809411526,
      "mae_dy": 0.0033025259617716074,
      "pose_mae_dtheta": 0.12948235869407654,
      "pose_mae_dx": 0.12494783103466034,
      "pose_mae_dy": 0.05014372617006302,
      "pose_rmse_dtheta": 0.28120407462120056,
      "pose_rmse_dx": 0.3071805238723755,
      "pose_rmse_dy": 0.10556702315807343,
      "pose_rmse_mean": 0.23131722211837769,
      "rmse_dtheta": 0.03857564181089401,
      "rmse_dx": 0.029168490320444107,
      "rmse_dy": 0.006432633381336927,
      "rmse_mean": 0.024725589901208878,
      "rotation_flip": 0.0063492064364254475,
      "sparse_tokens": 6172.0,
      "step": 3226,
      "turn_loss": 0.23323899507522583,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.14992566437465155,
      "grad_norm": 0.513674259185791,
      "learning_rate": 8.40612185391234e-06,
      "loss": 0.1063,
      "mae_dtheta": 0.011181773617863655,
      "mae_dx": 0.0018983129411935806,
      "mae_dy": 0.002960535464808345,
      "pose_mae_dtheta": 0.07624202966690063,
      "pose_mae_dx": 0.029067566618323326,
      "pose_mae_dy": 0.03770948946475983,
      "pose_rmse_dtheta": 0.16155284643173218,
      "pose_rmse_dx": 0.07581991702318192,
      "pose_rmse_dy": 0.08947568386793137,
      "pose_rmse_mean": 0.10894948244094849,
      "rmse_dtheta": 0.022043734788894653,
      "rmse_dx": 0.005401633679866791,
      "rmse_dy": 0.006474786438047886,
      "rmse_mean": 0.011306717991828918,
      "rotation_flip": 0.001490312977693975,
      "sparse_tokens": 32073.0,
      "step": 3227,
      "turn_loss": 0.10620376467704773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.14997212414049432,
      "grad_norm": 0.44749000668525696,
      "learning_rate": 8.405153771663295e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.0114525081589818,
      "mae_dx": 0.002107437467202544,
      "mae_dy": 0.002836222993209958,
      "pose_mae_dtheta": 0.07868403941392899,
      "pose_mae_dx": 0.02217351458966732,
      "pose_mae_dy": 0.030458834022283554,
      "pose_rmse_dtheta": 0.19878090918064117,
      "pose_rmse_dx": 0.05449667572975159,
      "pose_rmse_dy": 0.07086368650197983,
      "pose_rmse_mean": 0.10804709792137146,
      "rmse_dtheta": 0.025261040776968002,
      "rmse_dx": 0.006082638632506132,
      "rmse_dy": 0.00781374890357256,
      "rmse_mean": 0.013052476570010185,
      "rotation_flip": 0.007493443321436644,
      "sparse_tokens": 32121.0,
      "step": 3228,
      "turn_loss": 0.09857729077339172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1500185839063371,
      "grad_norm": 0.716526985168457,
      "learning_rate": 8.404185451290017e-06,
      "loss": 0.1599,
      "mae_dtheta": 0.018045993521809578,
      "mae_dx": 0.005005046259611845,
      "mae_dy": 0.004764322191476822,
      "pose_mae_dtheta": 0.12611550092697144,
      "pose_mae_dx": 0.043551504611968994,
      "pose_mae_dy": 0.0467909537255764,
      "pose_rmse_dtheta": 0.27392369508743286,
      "pose_rmse_dx": 0.09708104282617569,
      "pose_rmse_dy": 0.09711220115423203,
      "pose_rmse_mean": 0.15603898465633392,
      "rmse_dtheta": 0.03490705043077469,
      "rmse_dx": 0.014939546585083008,
      "rmse_dy": 0.010373493656516075,
      "rmse_mean": 0.020073365420103073,
      "rotation_flip": 0.008532983250916004,
      "sparse_tokens": 32169.0,
      "step": 3229,
      "turn_loss": 0.20794019103050232,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32986.0,
      "epoch": 0.1500650436721799,
      "grad_norm": 0.6451244354248047,
      "learning_rate": 8.403216892860225e-06,
      "loss": 0.2305,
      "mae_dtheta": 0.04456732049584389,
      "mae_dx": 0.01725366897881031,
      "mae_dy": 0.009456215426325798,
      "pose_mae_dtheta": 0.3647954761981964,
      "pose_mae_dx": 0.1368071436882019,
      "pose_mae_dy": 0.10052520036697388,
      "pose_rmse_dtheta": 0.5685524940490723,
      "pose_rmse_dx": 0.2844964861869812,
      "pose_rmse_dy": 0.2170076221227646,
      "pose_rmse_mean": 0.3566855192184448,
      "rmse_dtheta": 0.061592306941747665,
      "rmse_dx": 0.030785074457526207,
      "rmse_dy": 0.01787831448018551,
      "rmse_mean": 0.03675189986824989,
      "rotation_flip": 0.015446608886122704,
      "sparse_tokens": 27129.0,
      "step": 3230,
      "turn_loss": 0.4177762269973755,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.15011150343802268,
      "grad_norm": 0.40450793504714966,
      "learning_rate": 8.40224809644165e-06,
      "loss": 0.0965,
      "mae_dtheta": 0.032430827617645264,
      "mae_dx": 0.013966428115963936,
      "mae_dy": 0.005426270421594381,
      "pose_mae_dtheta": 0.26602089405059814,
      "pose_mae_dx": 0.09459490329027176,
      "pose_mae_dy": 0.07680226117372513,
      "pose_rmse_dtheta": 0.4151829779148102,
      "pose_rmse_dx": 0.20640605688095093,
      "pose_rmse_dy": 0.16747111082077026,
      "pose_rmse_mean": 0.2630200684070587,
      "rmse_dtheta": 0.046066559851169586,
      "rmse_dx": 0.025973578914999962,
      "rmse_dy": 0.009202253073453903,
      "rmse_mean": 0.027080800384283066,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 9782.0,
      "step": 3231,
      "turn_loss": 0.2912835478782654,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15015796320386546,
      "grad_norm": 0.39218762516975403,
      "learning_rate": 8.401279062102038e-06,
      "loss": 0.0981,
      "mae_dtheta": 0.008069268427789211,
      "mae_dx": 0.0012445192551240325,
      "mae_dy": 0.001881670905277133,
      "pose_mae_dtheta": 0.05648345127701759,
      "pose_mae_dx": 0.019826559349894524,
      "pose_mae_dy": 0.028192410245537758,
      "pose_rmse_dtheta": 0.11212685704231262,
      "pose_rmse_dx": 0.051831554621458054,
      "pose_rmse_dy": 0.06949669122695923,
      "pose_rmse_mean": 0.0778183713555336,
      "rmse_dtheta": 0.01555083692073822,
      "rmse_dx": 0.0035834661684930325,
      "rmse_dy": 0.0038707666099071503,
      "rmse_mean": 0.007668356876820326,
      "rotation_flip": 0.002066969871520996,
      "sparse_tokens": 32089.0,
      "step": 3232,
      "turn_loss": 0.06260433048009872,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.15020442296970823,
      "grad_norm": 0.38669353723526,
      "learning_rate": 8.400309789909155e-06,
      "loss": 0.1319,
      "mae_dtheta": 0.04010859131813049,
      "mae_dx": 0.015113570727407932,
      "mae_dy": 0.007170720025897026,
      "pose_mae_dtheta": 0.3367825746536255,
      "pose_mae_dx": 0.12699350714683533,
      "pose_mae_dy": 0.07038513571023941,
      "pose_rmse_dtheta": 0.5391284823417664,
      "pose_rmse_dx": 0.25039345026016235,
      "pose_rmse_dy": 0.19157275557518005,
      "pose_rmse_mean": 0.32703158259391785,
      "rmse_dtheta": 0.056943681091070175,
      "rmse_dx": 0.026919765397906303,
      "rmse_dy": 0.014721792191267014,
      "rmse_mean": 0.03286174684762955,
      "rotation_flip": 0.020604396238923073,
      "sparse_tokens": 11297.0,
      "step": 3233,
      "turn_loss": 0.346109002828598,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.150250882735551,
      "grad_norm": 0.5652549862861633,
      "learning_rate": 8.399340279930786e-06,
      "loss": 0.2415,
      "mae_dtheta": 0.013085592538118362,
      "mae_dx": 0.003213668242096901,
      "mae_dy": 0.004137484822422266,
      "pose_mae_dtheta": 0.0949031338095665,
      "pose_mae_dx": 0.03425101563334465,
      "pose_mae_dy": 0.03504519537091255,
      "pose_rmse_dtheta": 0.2193286418914795,
      "pose_rmse_dx": 0.09098203480243683,
      "pose_rmse_dy": 0.07954320311546326,
      "pose_rmse_mean": 0.12995129823684692,
      "rmse_dtheta": 0.027342598885297775,
      "rmse_dx": 0.00884834211319685,
      "rmse_dy": 0.010364536195993423,
      "rmse_mean": 0.0155184930190444,
      "rotation_flip": 0.006026365328580141,
      "sparse_tokens": 32137.0,
      "step": 3234,
      "turn_loss": 0.1284247189760208,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.1502973425013938,
      "grad_norm": 0.5332295894622803,
      "learning_rate": 8.398370532234723e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.016405455768108368,
      "mae_dx": 0.0046737608499825,
      "mae_dy": 0.005362855736166239,
      "pose_mae_dtheta": 0.11671163141727448,
      "pose_mae_dx": 0.0466657429933548,
      "pose_mae_dy": 0.05470766872167587,
      "pose_rmse_dtheta": 0.2524137496948242,
      "pose_rmse_dx": 0.11118669807910919,
      "pose_rmse_dy": 0.13400700688362122,
      "pose_rmse_mean": 0.16586914658546448,
      "rmse_dtheta": 0.031860385090112686,
      "rmse_dx": 0.010889898985624313,
      "rmse_dy": 0.012374714948236942,
      "rmse_mean": 0.01837499998509884,
      "rotation_flip": 0.008829300291836262,
      "sparse_tokens": 32201.0,
      "step": 3235,
      "turn_loss": 0.17348048090934753,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15034380226723656,
      "grad_norm": 0.5186557769775391,
      "learning_rate": 8.397400546888786e-06,
      "loss": 0.0826,
      "mae_dtheta": 0.006645281799137592,
      "mae_dx": 0.0014091173652559519,
      "mae_dy": 0.0012798571260645986,
      "pose_mae_dtheta": 0.04952474310994148,
      "pose_mae_dx": 0.014176229014992714,
      "pose_mae_dy": 0.018801968544721603,
      "pose_rmse_dtheta": 0.14658871293067932,
      "pose_rmse_dx": 0.04223790019750595,
      "pose_rmse_dy": 0.06005371734499931,
      "pose_rmse_mean": 0.0829601138830185,
      "rmse_dtheta": 0.017326481640338898,
      "rmse_dx": 0.005060877185314894,
      "rmse_dy": 0.00305937509983778,
      "rmse_mean": 0.008482245728373528,
      "rotation_flip": 0.004605936352163553,
      "sparse_tokens": 32089.0,
      "step": 3236,
      "turn_loss": 0.04674028977751732,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15039026203307934,
      "grad_norm": 0.8238176107406616,
      "learning_rate": 8.396430323960807e-06,
      "loss": 0.1575,
      "mae_dtheta": 0.014244063757359982,
      "mae_dx": 0.0023467466235160828,
      "mae_dy": 0.00390853313729167,
      "pose_mae_dtheta": 0.10180729627609253,
      "pose_mae_dx": 0.035618122667074203,
      "pose_mae_dy": 0.04385112598538399,
      "pose_rmse_dtheta": 0.2300829142332077,
      "pose_rmse_dx": 0.09251149743795395,
      "pose_rmse_dy": 0.11813795566558838,
      "pose_rmse_mean": 0.14691078662872314,
      "rmse_dtheta": 0.027845868840813637,
      "rmse_dx": 0.006102707237005234,
      "rmse_dy": 0.008181873708963394,
      "rmse_mean": 0.014043483883142471,
      "rotation_flip": 0.007862758822739124,
      "sparse_tokens": 32105.0,
      "step": 3237,
      "turn_loss": 0.1251785010099411,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.15043672179892215,
      "grad_norm": 0.4808402955532074,
      "learning_rate": 8.395459863518632e-06,
      "loss": 0.1218,
      "mae_dtheta": 0.03875807300209999,
      "mae_dx": 0.010890303179621696,
      "mae_dy": 0.00374586065299809,
      "pose_mae_dtheta": 0.3091945946216583,
      "pose_mae_dx": 0.08207125216722488,
      "pose_mae_dy": 0.04724938049912453,
      "pose_rmse_dtheta": 0.534561276435852,
      "pose_rmse_dx": 0.17831075191497803,
      "pose_rmse_dy": 0.12460414320230484,
      "pose_rmse_mean": 0.27915874123573303,
      "rmse_dtheta": 0.05824451148509979,
      "rmse_dx": 0.022508159279823303,
      "rmse_dy": 0.008655492216348648,
      "rmse_mean": 0.029802720993757248,
      "rotation_flip": 0.016713092103600502,
      "sparse_tokens": 11572.0,
      "step": 3238,
      "turn_loss": 0.29636600613594055,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.15048318156476492,
      "grad_norm": 0.4842063784599304,
      "learning_rate": 8.394489165630124e-06,
      "loss": 0.1481,
      "mae_dtheta": 0.01159599144011736,
      "mae_dx": 0.00228943582624197,
      "mae_dy": 0.0035167494788765907,
      "pose_mae_dtheta": 0.07733584195375443,
      "pose_mae_dx": 0.028442781418561935,
      "pose_mae_dy": 0.03689010068774223,
      "pose_rmse_dtheta": 0.16574320197105408,
      "pose_rmse_dx": 0.07308130711317062,
      "pose_rmse_dy": 0.10021606087684631,
      "pose_rmse_mean": 0.11301352828741074,
      "rmse_dtheta": 0.022209079936146736,
      "rmse_dx": 0.00654127262532711,
      "rmse_dy": 0.007995191030204296,
      "rmse_mean": 0.012248515151441097,
      "rotation_flip": 0.007246376946568489,
      "sparse_tokens": 32137.0,
      "step": 3239,
      "turn_loss": 0.11736702919006348,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29522.0,
      "epoch": 0.1505296413306077,
      "grad_norm": 0.5442847609519958,
      "learning_rate": 8.39351823036317e-06,
      "loss": 0.1771,
      "mae_dtheta": 0.03746166080236435,
      "mae_dx": 0.011042909696698189,
      "mae_dy": 0.005876915063709021,
      "pose_mae_dtheta": 0.3074224293231964,
      "pose_mae_dx": 0.10254734009504318,
      "pose_mae_dy": 0.05467795580625534,
      "pose_rmse_dtheta": 0.5313879251480103,
      "pose_rmse_dx": 0.21419908106327057,
      "pose_rmse_dy": 0.11800120770931244,
      "pose_rmse_mean": 0.28786274790763855,
      "rmse_dtheta": 0.05632749944925308,
      "rmse_dx": 0.022366009652614594,
      "rmse_dy": 0.012220645323395729,
      "rmse_mean": 0.030304718762636185,
      "rotation_flip": 0.011356045491993427,
      "sparse_tokens": 24197.0,
      "step": 3240,
      "turn_loss": 0.3002983629703522,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.15057610109645048,
      "grad_norm": 0.5675182342529297,
      "learning_rate": 8.392547057785662e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.037209704518318176,
      "mae_dx": 0.012454000301659107,
      "mae_dy": 0.004089638125151396,
      "pose_mae_dtheta": 0.3032165765762329,
      "pose_mae_dx": 0.08593498915433884,
      "pose_mae_dy": 0.0441935770213604,
      "pose_rmse_dtheta": 0.5476340055465698,
      "pose_rmse_dx": 0.1936650276184082,
      "pose_rmse_dy": 0.11882325261831284,
      "pose_rmse_mean": 0.28670743107795715,
      "rmse_dtheta": 0.0575890988111496,
      "rmse_dx": 0.024843404069542885,
      "rmse_dy": 0.009865529835224152,
      "rmse_mean": 0.030766010284423828,
      "rotation_flip": 0.017226528376340866,
      "sparse_tokens": 19744.0,
      "step": 3241,
      "turn_loss": 0.281183660030365,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15062256086229325,
      "grad_norm": 0.6639646291732788,
      "learning_rate": 8.391575647965518e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.009683092124760151,
      "mae_dx": 0.0018666712567210197,
      "mae_dy": 0.0018480829894542694,
      "pose_mae_dtheta": 0.07119869440793991,
      "pose_mae_dx": 0.019832303747534752,
      "pose_mae_dy": 0.02516048215329647,
      "pose_rmse_dtheta": 0.18400593101978302,
      "pose_rmse_dx": 0.056571148335933685,
      "pose_rmse_dy": 0.0601683035492897,
      "pose_rmse_mean": 0.10024845600128174,
      "rmse_dtheta": 0.021997928619384766,
      "rmse_dx": 0.006327811162918806,
      "rmse_dy": 0.003758730599656701,
      "rmse_mean": 0.010694824159145355,
      "rotation_flip": 0.002087682718411088,
      "sparse_tokens": 32121.0,
      "step": 3242,
      "turn_loss": 0.07732187956571579,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.15066902062813603,
      "grad_norm": 0.6086165904998779,
      "learning_rate": 8.390604000970669e-06,
      "loss": 0.1728,
      "mae_dtheta": 0.014214416034519672,
      "mae_dx": 0.0017611231887713075,
      "mae_dy": 0.003244565101340413,
      "pose_mae_dtheta": 0.09333168715238571,
      "pose_mae_dx": 0.030521182343363762,
      "pose_mae_dy": 0.04106862097978592,
      "pose_rmse_dtheta": 0.20689456164836884,
      "pose_rmse_dx": 0.07389437407255173,
      "pose_rmse_dy": 0.0842990130186081,
      "pose_rmse_mean": 0.12169598042964935,
      "rmse_dtheta": 0.026582222431898117,
      "rmse_dx": 0.005126170814037323,
      "rmse_dy": 0.006243659183382988,
      "rmse_mean": 0.012650683522224426,
      "rotation_flip": 0.007868628017604351,
      "sparse_tokens": 32057.0,
      "step": 3243,
      "turn_loss": 0.11895633488893509,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1507154803939788,
      "grad_norm": 0.3698728084564209,
      "learning_rate": 8.389632116869062e-06,
      "loss": 0.0854,
      "mae_dtheta": 0.006957688368856907,
      "mae_dx": 0.0011039763921871781,
      "mae_dy": 0.001718874671496451,
      "pose_mae_dtheta": 0.052877314388751984,
      "pose_mae_dx": 0.017990827560424805,
      "pose_mae_dy": 0.02862335927784443,
      "pose_rmse_dtheta": 0.11207810044288635,
      "pose_rmse_dx": 0.04866063594818115,
      "pose_rmse_dy": 0.07345618307590485,
      "pose_rmse_mean": 0.07806497812271118,
      "rmse_dtheta": 0.014449069276452065,
      "rmse_dx": 0.003536313772201538,
      "rmse_dy": 0.003859155345708132,
      "rmse_mean": 0.007281512953341007,
      "rotation_flip": 0.002298850566148758,
      "sparse_tokens": 32057.0,
      "step": 3244,
      "turn_loss": 0.0588524155318737,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.15076194015982158,
      "grad_norm": 0.4787372946739197,
      "learning_rate": 8.388659995728662e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.010165922343730927,
      "mae_dx": 0.002321480540558696,
      "mae_dy": 0.0019534339662641287,
      "pose_mae_dtheta": 0.06918064504861832,
      "pose_mae_dx": 0.026737388223409653,
      "pose_mae_dy": 0.02986166626214981,
      "pose_rmse_dtheta": 0.15638557076454163,
      "pose_rmse_dx": 0.07308872789144516,
      "pose_rmse_dy": 0.06816480308771133,
      "pose_rmse_mean": 0.09921303391456604,
      "rmse_dtheta": 0.021607600152492523,
      "rmse_dx": 0.007623767014592886,
      "rmse_dy": 0.003975795116275549,
      "rmse_mean": 0.011069054715335369,
      "rotation_flip": 0.0009298000950366259,
      "sparse_tokens": 32057.0,
      "step": 3245,
      "turn_loss": 0.1075933501124382,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1508083999256644,
      "grad_norm": 0.6295482516288757,
      "learning_rate": 8.38768763761745e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.010732370428740978,
      "mae_dx": 0.002324559260159731,
      "mae_dy": 0.002578736050054431,
      "pose_mae_dtheta": 0.07004942744970322,
      "pose_mae_dx": 0.026394210755825043,
      "pose_mae_dy": 0.02801532857120037,
      "pose_rmse_dtheta": 0.15449784696102142,
      "pose_rmse_dx": 0.0693386122584343,
      "pose_rmse_dy": 0.07021808624267578,
      "pose_rmse_mean": 0.09801818430423737,
      "rmse_dtheta": 0.022940952330827713,
      "rmse_dx": 0.00696755712851882,
      "rmse_dy": 0.006424397695809603,
      "rmse_mean": 0.012110969983041286,
      "rotation_flip": 0.0030268633272498846,
      "sparse_tokens": 32121.0,
      "step": 3246,
      "turn_loss": 0.10232424736022949,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.15085485969150716,
      "grad_norm": 0.49298664927482605,
      "learning_rate": 8.386715042603424e-06,
      "loss": 0.0826,
      "mae_dtheta": 0.009087538346648216,
      "mae_dx": 0.0013511090073734522,
      "mae_dy": 0.0017588228220120072,
      "pose_mae_dtheta": 0.059680212289094925,
      "pose_mae_dx": 0.016168270260095596,
      "pose_mae_dy": 0.021382762119174004,
      "pose_rmse_dtheta": 0.1477200835943222,
      "pose_rmse_dx": 0.04546061158180237,
      "pose_rmse_dy": 0.05238156393170357,
      "pose_rmse_mean": 0.08185409009456635,
      "rmse_dtheta": 0.021565573289990425,
      "rmse_dx": 0.00462478818371892,
      "rmse_dy": 0.004925074987113476,
      "rmse_mean": 0.01037181168794632,
      "rotation_flip": 0.0043691969476640224,
      "sparse_tokens": 32073.0,
      "step": 3247,
      "turn_loss": 0.07501909136772156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.15090131945734994,
      "grad_norm": 0.7041382789611816,
      "learning_rate": 8.385742210754594e-06,
      "loss": 0.158,
      "mae_dtheta": 0.009605690836906433,
      "mae_dx": 0.0016258573159575462,
      "mae_dy": 0.0017298029270023108,
      "pose_mae_dtheta": 0.06796452403068542,
      "pose_mae_dx": 0.02276652120053768,
      "pose_mae_dy": 0.02778688259422779,
      "pose_rmse_dtheta": 0.17527493834495544,
      "pose_rmse_dx": 0.0582757368683815,
      "pose_rmse_dy": 0.06453850120306015,
      "pose_rmse_mean": 0.0993630588054657,
      "rmse_dtheta": 0.021809957921504974,
      "rmse_dx": 0.005254142452031374,
      "rmse_dy": 0.0034087111707776785,
      "rmse_mean": 0.010157603770494461,
      "rotation_flip": 0.0036900369450449944,
      "sparse_tokens": 32057.0,
      "step": 3248,
      "turn_loss": 0.0743129774928093,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.15094777922319272,
      "grad_norm": 0.6024935245513916,
      "learning_rate": 8.384769142138998e-06,
      "loss": 0.1373,
      "mae_dtheta": 0.034379828721284866,
      "mae_dx": 0.012321383692324162,
      "mae_dy": 0.005986450705677271,
      "pose_mae_dtheta": 0.2593495845794678,
      "pose_mae_dx": 0.10043006390333176,
      "pose_mae_dy": 0.05547577887773514,
      "pose_rmse_dtheta": 0.546018123626709,
      "pose_rmse_dx": 0.24795645475387573,
      "pose_rmse_dy": 0.13668830692768097,
      "pose_rmse_mean": 0.31022095680236816,
      "rmse_dtheta": 0.05791372433304787,
      "rmse_dx": 0.026506375521421432,
      "rmse_dy": 0.011501111090183258,
      "rmse_mean": 0.031973738223314285,
      "rotation_flip": 0.007731958758085966,
      "sparse_tokens": 6243.0,
      "step": 3249,
      "turn_loss": 0.2644210159778595,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1509942389890355,
      "grad_norm": 0.6060128211975098,
      "learning_rate": 8.383795836824678e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.011174739338457584,
      "mae_dx": 0.0019534952007234097,
      "mae_dy": 0.0028024977073073387,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6060128808021545,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.6005859375,
      "model/head/act_norm_mean": 113.57500789141415,
      "model/head/act_norm_min": 60.41872024536133,
      "model/head/act_over_embed": 78.04980872895634,
      "model/head/grad_frac": 0.09174859523773193,
      "model/head/grad_norm": 0.05560082942247391,
      "model/head/grad_zero_frac": 0.0001713267556624487,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6929253472222222,
      "model/head/update_ratio": 0.0009585146326571703,
      "model/head/weight_delta": 6.696615219116211,
      "model/head/weight_delta_rel": 0.11747846752405167,
      "model/head/weight_norm": 58.00728225708008,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4166428744792938,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41656740470852016,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4164985418319702,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2862690204811829,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0719556212425232,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04360603168606758,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5324761771300448,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014141537249088287,
      "model/modality_embedder.encoders.pose/weight_delta": 2.199840784072876,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07187565416097641,
      "model/modality_embedder.encoders.pose/weight_norm": 30.835424423217773,
      "model/modality_embedder/grad_frac": 0.0719556212425232,
      "model/modality_embedder/grad_norm": 0.04360603168606758,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5324761771300448,
      "model/modality_embedder/update_ratio": 0.0014141537249088287,
      "model/modality_embedder/weight_delta": 2.199840784072876,
      "model/modality_embedder/weight_delta_rel": 0.07187565416097641,
      "model/modality_embedder/weight_norm": 30.835424423217773,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.18775177001953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.878088924963926,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.93322467803955,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.409246259425817,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07262570410966873,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04401211068034172,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015889669302850962,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.4947136640548706,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.054468266665935516,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.698570251464844,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.63101959228516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.92507415424082,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.333720207214355,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.128744311015048,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07299789041280746,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.044237662106752396,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015082532772794366,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.8832584619522095,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06523754447698593,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.330392837524414,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.35030364990234,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.875516073432742,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.330238342285156,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.46910625820868,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08338841795921326,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.050534456968307495,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016691978089511395,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.018808126449585,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06778779625892639,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.274696350097656,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.2756118774414,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.717136644219977,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.455910682678223,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.734685155977097,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11725299060344696,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07105682045221329,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.00239948439411819,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.7230406999588013,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0588853545486927,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.613370895385742,
      "model/normalizer/grad_frac": 0.4288152754306793,
      "model/normalizer/grad_norm": 0.2598675787448883,
      "model/normalizer/grad_zero_frac": 0.00017135207599494606,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003324692603200674,
      "model/normalizer/weight_delta": 3.665330648422241,
      "model/normalizer/weight_delta_rel": 0.047207336872816086,
      "model/normalizer/weight_norm": 78.16288757324219,
      "pose_mae_dtheta": 0.07797860354185104,
      "pose_mae_dx": 0.027316797524690628,
      "pose_mae_dy": 0.029831163585186005,
      "pose_rmse_dtheta": 0.20269989967346191,
      "pose_rmse_dx": 0.06651382893323898,
      "pose_rmse_dy": 0.07998479157686234,
      "pose_rmse_mean": 0.11639951169490814,
      "rmse_dtheta": 0.02415396273136139,
      "rmse_dx": 0.005272411275655031,
      "rmse_dy": 0.006315957754850388,
      "rmse_mean": 0.011914110742509365,
      "rotation_flip": 0.002568807452917099,
      "sparse_tokens": 32105.0,
      "step": 3250,
      "turn_loss": 0.09162978827953339,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.15104069875487827,
      "grad_norm": 0.5635237097740173,
      "learning_rate": 8.382822294879698e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.008481068536639214,
      "mae_dx": 0.002411853987723589,
      "mae_dy": 0.002012017648667097,
      "pose_mae_dtheta": 0.062307339161634445,
      "pose_mae_dx": 0.0248488187789917,
      "pose_mae_dy": 0.024825692176818848,
      "pose_rmse_dtheta": 0.18905074894428253,
      "pose_rmse_dx": 0.09880506247282028,
      "pose_rmse_dy": 0.09141755104064941,
      "pose_rmse_mean": 0.12642446160316467,
      "rmse_dtheta": 0.02244969829916954,
      "rmse_dx": 0.008872858248651028,
      "rmse_dy": 0.007819329388439655,
      "rmse_mean": 0.0130472956225276,
      "rotation_flip": 0.0025083611253648996,
      "sparse_tokens": 32169.0,
      "step": 3251,
      "turn_loss": 0.08472129702568054,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15108715852072105,
      "grad_norm": 0.6831645369529724,
      "learning_rate": 8.381848516372138e-06,
      "loss": 0.1048,
      "mae_dtheta": 0.00882472563534975,
      "mae_dx": 0.0012716884957626462,
      "mae_dy": 0.001826549181714654,
      "pose_mae_dtheta": 0.06351244449615479,
      "pose_mae_dx": 0.017686722800135612,
      "pose_mae_dy": 0.026400072500109673,
      "pose_rmse_dtheta": 0.1600906401872635,
      "pose_rmse_dx": 0.04547527804970741,
      "pose_rmse_dy": 0.07169262319803238,
      "pose_rmse_mean": 0.09241952002048492,
      "rmse_dtheta": 0.02105027623474598,
      "rmse_dx": 0.003963245078921318,
      "rmse_dy": 0.004386949818581343,
      "rmse_mean": 0.009800157509744167,
      "rotation_flip": 0.00797747541218996,
      "sparse_tokens": 32089.0,
      "step": 3252,
      "turn_loss": 0.05710463225841522,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.15113361828656383,
      "grad_norm": 0.5084943175315857,
      "learning_rate": 8.380874501370098e-06,
      "loss": 0.1898,
      "mae_dtheta": 0.0346100851893425,
      "mae_dx": 0.012011207640171051,
      "mae_dy": 0.003021681448444724,
      "pose_mae_dtheta": 0.27406319975852966,
      "pose_mae_dx": 0.08724446594715118,
      "pose_mae_dy": 0.03262120112776756,
      "pose_rmse_dtheta": 0.5148913860321045,
      "pose_rmse_dx": 0.19178596138954163,
      "pose_rmse_dy": 0.08797084540128708,
      "pose_rmse_mean": 0.26488274335861206,
      "rmse_dtheta": 0.0534898042678833,
      "rmse_dx": 0.02318939007818699,
      "rmse_dy": 0.006290676537901163,
      "rmse_mean": 0.027656622231006622,
      "rotation_flip": 0.013029315508902073,
      "sparse_tokens": 17827.0,
      "step": 3253,
      "turn_loss": 0.24866993725299835,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.1511800780524066,
      "grad_norm": 1.0084587335586548,
      "learning_rate": 8.379900249941688e-06,
      "loss": 0.2272,
      "mae_dtheta": 0.026959599927067757,
      "mae_dx": 0.007172260899096727,
      "mae_dy": 0.0069497679360210896,
      "pose_mae_dtheta": 0.2021193653345108,
      "pose_mae_dx": 0.09341831505298615,
      "pose_mae_dy": 0.10282398015260696,
      "pose_rmse_dtheta": 0.31545451283454895,
      "pose_rmse_dx": 0.19310715794563293,
      "pose_rmse_dy": 0.1654733270406723,
      "pose_rmse_mean": 0.22467833757400513,
      "rmse_dtheta": 0.03863472118973732,
      "rmse_dx": 0.017403393983840942,
      "rmse_dy": 0.010798853822052479,
      "rmse_mean": 0.02227899059653282,
      "rotation_flip": 0.006382978521287441,
      "sparse_tokens": 8174.0,
      "step": 3254,
      "turn_loss": 0.22702614963054657,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1512265378182494,
      "grad_norm": 0.5603970289230347,
      "learning_rate": 8.37892576215504e-06,
      "loss": 0.0719,
      "mae_dtheta": 0.011102674528956413,
      "mae_dx": 0.0025224939454346895,
      "mae_dy": 0.0029651327058672905,
      "pose_mae_dtheta": 0.08717972785234451,
      "pose_mae_dx": 0.025993280112743378,
      "pose_mae_dy": 0.030190404504537582,
      "pose_rmse_dtheta": 0.20996981859207153,
      "pose_rmse_dx": 0.06293889880180359,
      "pose_rmse_dy": 0.07360289990901947,
      "pose_rmse_mean": 0.11550386995077133,
      "rmse_dtheta": 0.02383539266884327,
      "rmse_dx": 0.006991741247475147,
      "rmse_dy": 0.007678871508687735,
      "rmse_mean": 0.012835334986448288,
      "rotation_flip": 0.008309248834848404,
      "sparse_tokens": 32153.0,
      "step": 3255,
      "turn_loss": 0.11168526858091354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15127299758409218,
      "grad_norm": 0.6119754314422607,
      "learning_rate": 8.377951038078303e-06,
      "loss": 0.1092,
      "mae_dtheta": 0.009219877421855927,
      "mae_dx": 0.0015718473587185144,
      "mae_dy": 0.001777126919478178,
      "pose_mae_dtheta": 0.06779945641756058,
      "pose_mae_dx": 0.018349675461649895,
      "pose_mae_dy": 0.02360963448882103,
      "pose_rmse_dtheta": 0.1847151666879654,
      "pose_rmse_dx": 0.04582042247056961,
      "pose_rmse_dy": 0.05156771093606949,
      "pose_rmse_mean": 0.09403443336486816,
      "rmse_dtheta": 0.022220740094780922,
      "rmse_dx": 0.005092285107821226,
      "rmse_dy": 0.003771179588511586,
      "rmse_mean": 0.010361402295529842,
      "rotation_flip": 0.0018752929754555225,
      "sparse_tokens": 32105.0,
      "step": 3256,
      "turn_loss": 0.08290120959281921,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15131945734993496,
      "grad_norm": 0.6596388816833496,
      "learning_rate": 8.376976077779633e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.008944551460444927,
      "mae_dx": 0.0019613837357610464,
      "mae_dy": 0.00228807027451694,
      "pose_mae_dtheta": 0.06025969237089157,
      "pose_mae_dx": 0.024273209273815155,
      "pose_mae_dy": 0.02451498620212078,
      "pose_rmse_dtheta": 0.13396397233009338,
      "pose_rmse_dx": 0.06375163048505783,
      "pose_rmse_dy": 0.05900486931204796,
      "pose_rmse_mean": 0.08557349443435669,
      "rmse_dtheta": 0.018656114116311073,
      "rmse_dx": 0.005905260797590017,
      "rmse_dy": 0.005154797807335854,
      "rmse_mean": 0.009905391372740269,
      "rotation_flip": 0.00324524799361825,
      "sparse_tokens": 32089.0,
      "step": 3257,
      "turn_loss": 0.09080439060926437,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15136591711577774,
      "grad_norm": 0.6847800016403198,
      "learning_rate": 8.376000881327215e-06,
      "loss": 0.1272,
      "mae_dtheta": 0.010060121305286884,
      "mae_dx": 0.002581795211881399,
      "mae_dy": 0.0031179541256278753,
      "pose_mae_dtheta": 0.07357041537761688,
      "pose_mae_dx": 0.027404969558119774,
      "pose_mae_dy": 0.030672188848257065,
      "pose_rmse_dtheta": 0.18384568393230438,
      "pose_rmse_dx": 0.06960897892713547,
      "pose_rmse_dy": 0.0707908347249031,
      "pose_rmse_mean": 0.10808183252811432,
      "rmse_dtheta": 0.022549260407686234,
      "rmse_dx": 0.008018484339118004,
      "rmse_dy": 0.008494353853166103,
      "rmse_mean": 0.013020699843764305,
      "rotation_flip": 0.003926701378077269,
      "sparse_tokens": 32089.0,
      "step": 3258,
      "turn_loss": 0.11383885145187378,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.15141237688162051,
      "grad_norm": 0.9108622670173645,
      "learning_rate": 8.375025448789242e-06,
      "loss": 0.2549,
      "mae_dtheta": 0.0398513525724411,
      "mae_dx": 0.01482835691422224,
      "mae_dy": 0.010134496726095676,
      "pose_mae_dtheta": 0.2767283022403717,
      "pose_mae_dx": 0.11629285663366318,
      "pose_mae_dy": 0.12693433463573456,
      "pose_rmse_dtheta": 0.4720149040222168,
      "pose_rmse_dx": 0.23922891914844513,
      "pose_rmse_dy": 0.24448812007904053,
      "pose_rmse_mean": 0.3185773193836212,
      "rmse_dtheta": 0.05649822577834129,
      "rmse_dx": 0.027666984125971794,
      "rmse_dy": 0.016610242426395416,
      "rmse_mean": 0.03359181806445122,
      "rotation_flip": 0.01253132801502943,
      "sparse_tokens": 13300.0,
      "step": 3259,
      "turn_loss": 0.3671610951423645,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1514588366474633,
      "grad_norm": 0.6542788147926331,
      "learning_rate": 8.374049780233929e-06,
      "loss": 0.1623,
      "mae_dtheta": 0.007474860176444054,
      "mae_dx": 0.0021729753352701664,
      "mae_dy": 0.0012267949059605598,
      "pose_mae_dtheta": 0.055113740265369415,
      "pose_mae_dx": 0.017224539071321487,
      "pose_mae_dy": 0.013303795829415321,
      "pose_rmse_dtheta": 0.18621651828289032,
      "pose_rmse_dx": 0.05351151153445244,
      "pose_rmse_dy": 0.034372441470623016,
      "pose_rmse_mean": 0.09136682748794556,
      "rmse_dtheta": 0.022064127027988434,
      "rmse_dx": 0.007451891433447599,
      "rmse_dy": 0.004600564483553171,
      "rmse_mean": 0.011372195556759834,
      "rotation_flip": 0.002952755894511938,
      "sparse_tokens": 32153.0,
      "step": 3260,
      "turn_loss": 0.06603607535362244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.15150529641330607,
      "grad_norm": 0.7499702572822571,
      "learning_rate": 8.373073875729504e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.009296574629843235,
      "mae_dx": 0.0021788098383694887,
      "mae_dy": 0.0018706105183809996,
      "pose_mae_dtheta": 0.06896834075450897,
      "pose_mae_dx": 0.025116287171840668,
      "pose_mae_dy": 0.028154797852039337,
      "pose_rmse_dtheta": 0.155796617269516,
      "pose_rmse_dx": 0.06101235747337341,
      "pose_rmse_dy": 0.06790897995233536,
      "pose_rmse_mean": 0.09490598738193512,
      "rmse_dtheta": 0.01897907257080078,
      "rmse_dx": 0.00677498010918498,
      "rmse_dy": 0.0037049497477710247,
      "rmse_mean": 0.009819667786359787,
      "rotation_flip": 0.00273348530754447,
      "sparse_tokens": 32057.0,
      "step": 3261,
      "turn_loss": 0.07632393389940262,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.15155175617914884,
      "grad_norm": 1.0293939113616943,
      "learning_rate": 8.372097735344212e-06,
      "loss": 0.1676,
      "mae_dtheta": 0.04588999226689339,
      "mae_dx": 0.006927758455276489,
      "mae_dy": 0.002667994238436222,
      "pose_mae_dtheta": 0.43706193566322327,
      "pose_mae_dx": 0.06663256138563156,
      "pose_mae_dy": 0.023482490330934525,
      "pose_rmse_dtheta": 0.6986035108566284,
      "pose_rmse_dx": 0.14038115739822388,
      "pose_rmse_dy": 0.06354673951864243,
      "pose_rmse_mean": 0.3008438050746918,
      "rmse_dtheta": 0.06738762557506561,
      "rmse_dx": 0.01545525062829256,
      "rmse_dy": 0.006724639795720577,
      "rmse_mean": 0.029855839908123016,
      "rotation_flip": 0.018656715750694275,
      "sparse_tokens": 8575.0,
      "step": 3262,
      "turn_loss": 0.3027838468551636,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.15159821594499165,
      "grad_norm": 0.7132125496864319,
      "learning_rate": 8.371121359146316e-06,
      "loss": 0.1478,
      "mae_dtheta": 0.009847426787018776,
      "mae_dx": 0.0020224624313414097,
      "mae_dy": 0.0026033513713628054,
      "pose_mae_dtheta": 0.07128673046827316,
      "pose_mae_dx": 0.02594849281013012,
      "pose_mae_dy": 0.02987089566886425,
      "pose_rmse_dtheta": 0.1806538999080658,
      "pose_rmse_dx": 0.07049012929201126,
      "pose_rmse_dy": 0.07176592946052551,
      "pose_rmse_mean": 0.10763665288686752,
      "rmse_dtheta": 0.02124403417110443,
      "rmse_dx": 0.0068754758685827255,
      "rmse_dy": 0.005818658042699099,
      "rmse_mean": 0.011312723159790039,
      "rotation_flip": 0.002689376939088106,
      "sparse_tokens": 32041.0,
      "step": 3263,
      "turn_loss": 0.07808088511228561,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.15164467571083443,
      "grad_norm": 1.0328859090805054,
      "learning_rate": 8.370144747204094e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.03813638165593147,
      "mae_dx": 0.008582882583141327,
      "mae_dy": 0.007074608467519283,
      "pose_mae_dtheta": 0.3227808475494385,
      "pose_mae_dx": 0.08651580661535263,
      "pose_mae_dy": 0.11160771548748016,
      "pose_rmse_dtheta": 0.5696079134941101,
      "pose_rmse_dx": 0.19050538539886475,
      "pose_rmse_dy": 0.24873614311218262,
      "pose_rmse_mean": 0.3362831473350525,
      "rmse_dtheta": 0.05663381516933441,
      "rmse_dx": 0.019717566668987274,
      "rmse_dy": 0.013399848714470863,
      "rmse_mean": 0.029917076230049133,
      "rotation_flip": 0.027272727340459824,
      "sparse_tokens": 7211.0,
      "step": 3264,
      "turn_loss": 0.23174649477005005,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1516911354766772,
      "grad_norm": 0.47764018177986145,
      "learning_rate": 8.36916789958584e-06,
      "loss": 0.1584,
      "mae_dtheta": 0.011037818156182766,
      "mae_dx": 0.0017741206102073193,
      "mae_dy": 0.002211309038102627,
      "pose_mae_dtheta": 0.07561439275741577,
      "pose_mae_dx": 0.021629273891448975,
      "pose_mae_dy": 0.027063407003879547,
      "pose_rmse_dtheta": 0.20487678050994873,
      "pose_rmse_dx": 0.053357142955064774,
      "pose_rmse_dy": 0.05788775905966759,
      "pose_rmse_mean": 0.10537390410900116,
      "rmse_dtheta": 0.02493892051279545,
      "rmse_dx": 0.005059440154582262,
      "rmse_dy": 0.0044527496211230755,
      "rmse_mean": 0.011483702808618546,
      "rotation_flip": 0.00496806250885129,
      "sparse_tokens": 32137.0,
      "step": 3265,
      "turn_loss": 0.08222629874944687,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.15173759524251998,
      "grad_norm": 0.7518518567085266,
      "learning_rate": 8.368190816359867e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.02478596568107605,
      "mae_dx": 0.010376517660915852,
      "mae_dy": 0.00576348602771759,
      "pose_mae_dtheta": 0.17153294384479523,
      "pose_mae_dx": 0.08731753379106522,
      "pose_mae_dy": 0.054354917258024216,
      "pose_rmse_dtheta": 0.23681658506393433,
      "pose_rmse_dx": 0.16686473786830902,
      "pose_rmse_dy": 0.08916899561882019,
      "pose_rmse_mean": 0.16428345441818237,
      "rmse_dtheta": 0.03553638234734535,
      "rmse_dx": 0.019322242587804794,
      "rmse_dy": 0.010347611270844936,
      "rmse_mean": 0.021735412999987602,
      "rotation_flip": 0.013333333656191826,
      "sparse_tokens": 5295.0,
      "step": 3266,
      "turn_loss": 0.2950092554092407,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.15178405500836276,
      "grad_norm": 0.6009239554405212,
      "learning_rate": 8.367213497594501e-06,
      "loss": 0.1488,
      "mae_dtheta": 0.012147696688771248,
      "mae_dx": 0.002223181538283825,
      "mae_dy": 0.003810433205217123,
      "pose_mae_dtheta": 0.0845392495393753,
      "pose_mae_dx": 0.038621749728918076,
      "pose_mae_dy": 0.04326390102505684,
      "pose_rmse_dtheta": 0.17638598382472992,
      "pose_rmse_dx": 0.10868427902460098,
      "pose_rmse_dy": 0.10191328823566437,
      "pose_rmse_mean": 0.12899452447891235,
      "rmse_dtheta": 0.024023689329624176,
      "rmse_dx": 0.006209244951605797,
      "rmse_dy": 0.00827722903341055,
      "rmse_mean": 0.012836720794439316,
      "rotation_flip": 0.006595218554139137,
      "sparse_tokens": 32057.0,
      "step": 3267,
      "turn_loss": 0.11414283514022827,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20129.0,
      "epoch": 0.15183051477420553,
      "grad_norm": 0.8438145518302917,
      "learning_rate": 8.36623594335809e-06,
      "loss": 0.188,
      "mae_dtheta": 0.03834739327430725,
      "mae_dx": 0.010683865286409855,
      "mae_dy": 0.006743873935192823,
      "pose_mae_dtheta": 0.2940622866153717,
      "pose_mae_dx": 0.09417905658483505,
      "pose_mae_dy": 0.06470180302858353,
      "pose_rmse_dtheta": 0.501332700252533,
      "pose_rmse_dx": 0.20122654736042023,
      "pose_rmse_dy": 0.1554640829563141,
      "pose_rmse_mean": 0.28600776195526123,
      "rmse_dtheta": 0.05539116635918617,
      "rmse_dx": 0.021268146112561226,
      "rmse_dy": 0.014388772659003735,
      "rmse_mean": 0.030349362641572952,
      "rotation_flip": 0.013527575880289078,
      "sparse_tokens": 14783.0,
      "step": 3268,
      "turn_loss": 0.34416207671165466,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.1518769745400483,
      "grad_norm": 0.8587550520896912,
      "learning_rate": 8.365258153718993e-06,
      "loss": 0.0962,
      "mae_dtheta": 0.007675596047192812,
      "mae_dx": 0.0019692848436534405,
      "mae_dy": 0.0002356778277317062,
      "pose_mae_dtheta": 0.05380985885858536,
      "pose_mae_dx": 0.015972798690199852,
      "pose_mae_dy": 0.003569785039871931,
      "pose_rmse_dtheta": 0.2331945151090622,
      "pose_rmse_dx": 0.03795335814356804,
      "pose_rmse_dy": 0.0068312822841107845,
      "pose_rmse_mean": 0.09265972673892975,
      "rmse_dtheta": 0.029105888679623604,
      "rmse_dx": 0.0053743538446724415,
      "rmse_dy": 0.0004091602750122547,
      "rmse_mean": 0.011629801243543625,
      "rotation_flip": 0.0025873221457004547,
      "sparse_tokens": 32201.0,
      "step": 3269,
      "turn_loss": 0.05424494668841362,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1519234343058911,
      "grad_norm": 0.7945581078529358,
      "learning_rate": 8.364280128745585e-06,
      "loss": 0.1603,
      "mae_dtheta": 0.012742131017148495,
      "mae_dx": 0.0020751869305968285,
      "mae_dy": 0.002927574561908841,
      "pose_mae_dtheta": 0.08699172735214233,
      "pose_mae_dx": 0.02488681674003601,
      "pose_mae_dy": 0.03421933948993683,
      "pose_rmse_dtheta": 0.20133960247039795,
      "pose_rmse_dx": 0.06365147233009338,
      "pose_rmse_dy": 0.07867240905761719,
      "pose_rmse_mean": 0.1145544946193695,
      "rmse_dtheta": 0.02504582330584526,
      "rmse_dx": 0.0064346399158239365,
      "rmse_dy": 0.006660556886345148,
      "rmse_mean": 0.012713673524558544,
      "rotation_flip": 0.0023890784941613674,
      "sparse_tokens": 32105.0,
      "step": 3270,
      "turn_loss": 0.10362507402896881,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1519698940717339,
      "grad_norm": 0.6206437945365906,
      "learning_rate": 8.363301868506264e-06,
      "loss": 0.1572,
      "mae_dtheta": 0.008083167485892773,
      "mae_dx": 0.0015482308808714151,
      "mae_dy": 0.0010885825613513589,
      "pose_mae_dtheta": 0.055832214653491974,
      "pose_mae_dx": 0.019430607557296753,
      "pose_mae_dy": 0.01724289543926716,
      "pose_rmse_dtheta": 0.1807536482810974,
      "pose_rmse_dx": 0.05474220588803291,
      "pose_rmse_dy": 0.043738968670368195,
      "pose_rmse_mean": 0.09307827800512314,
      "rmse_dtheta": 0.023188121616840363,
      "rmse_dx": 0.005456363316625357,
      "rmse_dy": 0.0024959363508969545,
      "rmse_mean": 0.01038014143705368,
      "rotation_flip": 0.0033021464478224516,
      "sparse_tokens": 32073.0,
      "step": 3271,
      "turn_loss": 0.05720268562436104,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.15201635383757667,
      "grad_norm": 0.5571309328079224,
      "learning_rate": 8.362323373069437e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.02939164638519287,
      "mae_dx": 0.008952387608587742,
      "mae_dy": 0.00462378142401576,
      "pose_mae_dtheta": 0.18403370678424835,
      "pose_mae_dx": 0.0790286585688591,
      "pose_mae_dy": 0.05619650334119797,
      "pose_rmse_dtheta": 0.33696508407592773,
      "pose_rmse_dx": 0.19103194773197174,
      "pose_rmse_dy": 0.12984518706798553,
      "pose_rmse_mean": 0.21928074955940247,
      "rmse_dtheta": 0.0461106151342392,
      "rmse_dx": 0.020822599530220032,
      "rmse_dy": 0.008239955641329288,
      "rmse_mean": 0.025057723745703697,
      "rotation_flip": 0.00397351011633873,
      "sparse_tokens": 13800.0,
      "step": 3272,
      "turn_loss": 0.2157743126153946,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.15206281360341944,
      "grad_norm": 0.6051948070526123,
      "learning_rate": 8.361344642503531e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.040744706988334656,
      "mae_dx": 0.018717018887400627,
      "mae_dy": 0.008847294375300407,
      "pose_mae_dtheta": 0.27340561151504517,
      "pose_mae_dx": 0.17864564061164856,
      "pose_mae_dy": 0.10667344182729721,
      "pose_rmse_dtheta": 0.5323265790939331,
      "pose_rmse_dx": 0.35054922103881836,
      "pose_rmse_dy": 0.18134810030460358,
      "pose_rmse_mean": 0.35474130511283875,
      "rmse_dtheta": 0.058609236031770706,
      "rmse_dx": 0.03302990645170212,
      "rmse_dy": 0.013947946019470692,
      "rmse_mean": 0.03519570082426071,
      "rotation_flip": 0.01075268816202879,
      "sparse_tokens": 4842.0,
      "step": 3273,
      "turn_loss": 0.3934106230735779,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15210927336926222,
      "grad_norm": 0.7948445677757263,
      "learning_rate": 8.36036567687699e-06,
      "loss": 0.1523,
      "mae_dtheta": 0.009275633841753006,
      "mae_dx": 0.001516020973213017,
      "mae_dy": 0.001958810491487384,
      "pose_mae_dtheta": 0.06350470334291458,
      "pose_mae_dx": 0.02008073218166828,
      "pose_mae_dy": 0.02317456156015396,
      "pose_rmse_dtheta": 0.1991851031780243,
      "pose_rmse_dx": 0.04892655834555626,
      "pose_rmse_dy": 0.05300161987543106,
      "pose_rmse_mean": 0.1003710925579071,
      "rmse_dtheta": 0.024291982874274254,
      "rmse_dx": 0.004376562312245369,
      "rmse_dy": 0.0044975909404456615,
      "rmse_mean": 0.011055379174649715,
      "rotation_flip": 0.003470715833827853,
      "sparse_tokens": 32105.0,
      "step": 3274,
      "turn_loss": 0.07047588378190994,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.152155733135105,
      "grad_norm": 0.503223717212677,
      "learning_rate": 8.359386476258276e-06,
      "loss": 0.0881,
      "mae_dtheta": 0.04301536828279495,
      "mae_dx": 0.014106884598731995,
      "mae_dy": 0.006015629507601261,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5032238364219666,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 132.7840118408203,
      "model/head/act_norm_mean": 106.94626871744792,
      "model/head/act_norm_min": 85.28228759765625,
      "model/head/act_over_embed": 73.49447710937284,
      "model/head/grad_frac": 0.09024782478809357,
      "model/head/grad_norm": 0.04541485756635666,
      "model/head/grad_zero_frac": 0.00016593313193880022,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6800944010416666,
      "model/head/update_ratio": 0.0007828350062482059,
      "model/head/weight_delta": 6.721434593200684,
      "model/head/weight_delta_rel": 0.1179138720035553,
      "model/head/weight_norm": 58.01332092285156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4167572855949402,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4167572855949402,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4167572855949402,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2863995084040236,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07880870997905731,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03965841978788376,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001286118058487773,
      "model/modality_embedder.encoders.pose/weight_delta": 2.207751989364624,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07213413715362549,
      "model/modality_embedder.encoders.pose/weight_norm": 30.83575439453125,
      "model/modality_embedder/grad_frac": 0.07880870997905731,
      "model/modality_embedder/grad_norm": 0.03965841978788376,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.001286118058487773,
      "model/modality_embedder/weight_delta": 2.207751989364624,
      "model/modality_embedder/weight_delta_rel": 0.07213413715362549,
      "model/modality_embedder/weight_norm": 30.83575439453125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.11782836914062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.19072162285053,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.045402526855469,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.936881014179418,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06439579278230667,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03240549936890602,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011698724702000618,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.5028444528579712,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.054764557629823685,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.700027465820312,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.29974365234375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.082599619708994,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.538799285888672,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.549787923513918,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07091835141181946,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.035687804222106934,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012166340602561831,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.8936887979507446,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06559886038303375,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.333227157592773,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 73.69886016845703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.757662657076718,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.111371994018555,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.70090692498025,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0881442278623581,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04435627534985542,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001464964123442769,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.0313193798065186,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06820790469646454,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.27806282043457,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 73.86664581298828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.667656146660054,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.397980690002441,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.013472332662698,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11218062788248062,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05645196512341499,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019061402417719364,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.7331860065460205,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05923207104206085,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.6158504486084,
      "model/normalizer/grad_frac": 0.393802672624588,
      "model/normalizer/grad_norm": 0.19817088544368744,
      "model/normalizer/grad_zero_frac": 0.00014180860307533294,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0025352383963763714,
      "model/normalizer/weight_delta": 3.6868033409118652,
      "model/normalizer/weight_delta_rel": 0.047483891248703,
      "model/normalizer/weight_norm": 78.16656494140625,
      "pose_mae_dtheta": 0.39750370383262634,
      "pose_mae_dx": 0.09446220099925995,
      "pose_mae_dy": 0.0838668942451477,
      "pose_rmse_dtheta": 0.6463570594787598,
      "pose_rmse_dx": 0.1905401051044464,
      "pose_rmse_dy": 0.19501303136348724,
      "pose_rmse_mean": 0.34397006034851074,
      "rmse_dtheta": 0.06291281431913376,
      "rmse_dx": 0.025974703952670097,
      "rmse_dy": 0.012920331209897995,
      "rmse_mean": 0.033935949206352234,
      "rotation_flip": 0.024193547666072845,
      "sparse_tokens": 5722.0,
      "step": 3275,
      "turn_loss": 0.27804431319236755,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.15220219290094777,
      "grad_norm": 0.7362955212593079,
      "learning_rate": 8.358407040715861e-06,
      "loss": 0.1729,
      "mae_dtheta": 0.01814756728708744,
      "mae_dx": 0.002964017679914832,
      "mae_dy": 0.006173563189804554,
      "pose_mae_dtheta": 0.12156444042921066,
      "pose_mae_dx": 0.04322813078761101,
      "pose_mae_dy": 0.06898337602615356,
      "pose_rmse_dtheta": 0.2534893751144409,
      "pose_rmse_dx": 0.09203168749809265,
      "pose_rmse_dy": 0.20621350407600403,
      "pose_rmse_mean": 0.18391153216362,
      "rmse_dtheta": 0.031104179099202156,
      "rmse_dx": 0.007841585204005241,
      "rmse_dy": 0.015091581270098686,
      "rmse_mean": 0.018012449145317078,
      "rotation_flip": 0.005635566543787718,
      "sparse_tokens": 32073.0,
      "step": 3276,
      "turn_loss": 0.1800115555524826,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.15224865266679055,
      "grad_norm": 0.6070143580436707,
      "learning_rate": 8.357427370318239e-06,
      "loss": 0.15,
      "mae_dtheta": 0.008249005302786827,
      "mae_dx": 0.002670798683539033,
      "mae_dy": 0.001966605195775628,
      "pose_mae_dtheta": 0.054662421345710754,
      "pose_mae_dx": 0.029521377757191658,
      "pose_mae_dy": 0.027096759527921677,
      "pose_rmse_dtheta": 0.12757986783981323,
      "pose_rmse_dx": 0.11172328889369965,
      "pose_rmse_dy": 0.07360238581895828,
      "pose_rmse_mean": 0.10430185496807098,
      "rmse_dtheta": 0.01676667109131813,
      "rmse_dx": 0.010342594236135483,
      "rmse_dy": 0.004886348731815815,
      "rmse_mean": 0.010665204375982285,
      "rotation_flip": 0.0031813362147659063,
      "sparse_tokens": 32041.0,
      "step": 3277,
      "turn_loss": 0.07969648391008377,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.15229511243263333,
      "grad_norm": 0.5346090793609619,
      "learning_rate": 8.356447465133918e-06,
      "loss": 0.0939,
      "mae_dtheta": 0.00915480311959982,
      "mae_dx": 0.001979764550924301,
      "mae_dy": 0.0017406197730451822,
      "pose_mae_dtheta": 0.06621963530778885,
      "pose_mae_dx": 0.02165951021015644,
      "pose_mae_dy": 0.022796237841248512,
      "pose_rmse_dtheta": 0.17034626007080078,
      "pose_rmse_dx": 0.058770518749952316,
      "pose_rmse_dy": 0.06179281324148178,
      "pose_rmse_mean": 0.09696986526250839,
      "rmse_dtheta": 0.02155756764113903,
      "rmse_dx": 0.005551750306040049,
      "rmse_dy": 0.003835414769127965,
      "rmse_mean": 0.010314911603927612,
      "rotation_flip": 0.006260869558900595,
      "sparse_tokens": 32201.0,
      "step": 3278,
      "turn_loss": 0.06682456284761429,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.15234157219847613,
      "grad_norm": 0.7953810691833496,
      "learning_rate": 8.355467325231425e-06,
      "loss": 0.1818,
      "mae_dtheta": 0.03297583386301994,
      "mae_dx": 0.007027351297438145,
      "mae_dy": 0.005357416346669197,
      "pose_mae_dtheta": 0.2644839882850647,
      "pose_mae_dx": 0.038795653730630875,
      "pose_mae_dy": 0.08391126245260239,
      "pose_rmse_dtheta": 0.4937233030796051,
      "pose_rmse_dx": 0.07986971735954285,
      "pose_rmse_dy": 0.1703764796257019,
      "pose_rmse_mean": 0.24798983335494995,
      "rmse_dtheta": 0.051782168447971344,
      "rmse_dx": 0.01690179482102394,
      "rmse_dy": 0.009731829166412354,
      "rmse_mean": 0.02613859996199608,
      "rotation_flip": 0.00931098684668541,
      "sparse_tokens": 9929.0,
      "step": 3279,
      "turn_loss": 0.25995808839797974,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1523880319643189,
      "grad_norm": 0.5902328491210938,
      "learning_rate": 8.354486950679301e-06,
      "loss": 0.1289,
      "mae_dtheta": 0.011062322184443474,
      "mae_dx": 0.002974874572828412,
      "mae_dy": 0.003716591279953718,
      "pose_mae_dtheta": 0.08225623518228531,
      "pose_mae_dx": 0.03959151729941368,
      "pose_mae_dy": 0.030241910368204117,
      "pose_rmse_dtheta": 0.21264007687568665,
      "pose_rmse_dx": 0.09328803420066833,
      "pose_rmse_dy": 0.06788235157728195,
      "pose_rmse_mean": 0.12460349500179291,
      "rmse_dtheta": 0.023361191153526306,
      "rmse_dx": 0.006939272861927748,
      "rmse_dy": 0.008614934049546719,
      "rmse_mean": 0.012971799820661545,
      "rotation_flip": 0.00568752083927393,
      "sparse_tokens": 32153.0,
      "step": 3280,
      "turn_loss": 0.10878065973520279,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.1524344917301617,
      "grad_norm": 0.6050454378128052,
      "learning_rate": 8.353506341546106e-06,
      "loss": 0.1696,
      "mae_dtheta": 0.030855601653456688,
      "mae_dx": 0.01121441088616848,
      "mae_dy": 0.004357107914984226,
      "pose_mae_dtheta": 0.26468145847320557,
      "pose_mae_dx": 0.09561262279748917,
      "pose_mae_dy": 0.04843246564269066,
      "pose_rmse_dtheta": 0.5126466751098633,
      "pose_rmse_dx": 0.20768451690673828,
      "pose_rmse_dy": 0.13463731110095978,
      "pose_rmse_mean": 0.28498950600624084,
      "rmse_dtheta": 0.05009138956665993,
      "rmse_dx": 0.02326902002096176,
      "rmse_dy": 0.00938962958753109,
      "rmse_mean": 0.027583349496126175,
      "rotation_flip": 0.009925558231770992,
      "sparse_tokens": 7782.0,
      "step": 3281,
      "turn_loss": 0.3101270794868469,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.15248095149600446,
      "grad_norm": 0.5511040687561035,
      "learning_rate": 8.35252549790041e-06,
      "loss": 0.1232,
      "mae_dtheta": 0.04064049571752548,
      "mae_dx": 0.01542567927390337,
      "mae_dy": 0.005770693067461252,
      "pose_mae_dtheta": 0.34072527289390564,
      "pose_mae_dx": 0.10582590103149414,
      "pose_mae_dy": 0.07648950070142746,
      "pose_rmse_dtheta": 0.585532546043396,
      "pose_rmse_dx": 0.24699072539806366,
      "pose_rmse_dy": 0.15325653553009033,
      "pose_rmse_mean": 0.32859328389167786,
      "rmse_dtheta": 0.05887556076049805,
      "rmse_dx": 0.030115511268377304,
      "rmse_dy": 0.00938434712588787,
      "rmse_mean": 0.03279180824756622,
      "rotation_flip": 0.01795332133769989,
      "sparse_tokens": 9349.0,
      "step": 3282,
      "turn_loss": 0.302109032869339,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 26848.0,
      "epoch": 0.15252741126184724,
      "grad_norm": 0.7691805362701416,
      "learning_rate": 8.351544419810808e-06,
      "loss": 0.149,
      "mae_dtheta": 0.03147658333182335,
      "mae_dx": 0.009863097220659256,
      "mae_dy": 0.003954030107706785,
      "pose_mae_dtheta": 0.26083895564079285,
      "pose_mae_dx": 0.08193895220756531,
      "pose_mae_dy": 0.0475904606282711,
      "pose_rmse_dtheta": 0.47779393196105957,
      "pose_rmse_dx": 0.1900346428155899,
      "pose_rmse_dy": 0.10471291095018387,
      "pose_rmse_mean": 0.2575138211250305,
      "rmse_dtheta": 0.050055816769599915,
      "rmse_dx": 0.021720677614212036,
      "rmse_dy": 0.007349693216383457,
      "rmse_mean": 0.02637539617717266,
      "rotation_flip": 0.016317015513777733,
      "sparse_tokens": 20138.0,
      "step": 3283,
      "turn_loss": 0.2500484585762024,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.15257387102769002,
      "grad_norm": 0.4421432614326477,
      "learning_rate": 8.350563107345905e-06,
      "loss": 0.0894,
      "mae_dtheta": 0.007509924937039614,
      "mae_dx": 0.0017926812870427966,
      "mae_dy": 0.0006874763639643788,
      "pose_mae_dtheta": 0.05544416233897209,
      "pose_mae_dx": 0.014232604764401913,
      "pose_mae_dy": 0.009996234439313412,
      "pose_rmse_dtheta": 0.19928140938282013,
      "pose_rmse_dx": 0.03599020466208458,
      "pose_rmse_dy": 0.029973596334457397,
      "pose_rmse_mean": 0.08841507136821747,
      "rmse_dtheta": 0.02365071512758732,
      "rmse_dx": 0.0054232110269367695,
      "rmse_dy": 0.0019495986634865403,
      "rmse_mean": 0.010341174900531769,
      "rotation_flip": 0.003977272659540176,
      "sparse_tokens": 32185.0,
      "step": 3284,
      "turn_loss": 0.06511054933071136,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1526203307935328,
      "grad_norm": 0.7033916115760803,
      "learning_rate": 8.349581560574326e-06,
      "loss": 0.1889,
      "mae_dtheta": 0.01310774963349104,
      "mae_dx": 0.0027851585764437914,
      "mae_dy": 0.0035111606121063232,
      "pose_mae_dtheta": 0.09430162608623505,
      "pose_mae_dx": 0.032677941024303436,
      "pose_mae_dy": 0.03808200731873512,
      "pose_rmse_dtheta": 0.25090911984443665,
      "pose_rmse_dx": 0.10895568132400513,
      "pose_rmse_dy": 0.11502249538898468,
      "pose_rmse_mean": 0.15829578042030334,
      "rmse_dtheta": 0.029903335496783257,
      "rmse_dx": 0.008080994710326195,
      "rmse_dy": 0.01006736233830452,
      "rmse_mean": 0.016017232090234756,
      "rotation_flip": 0.005887300241738558,
      "sparse_tokens": 32105.0,
      "step": 3285,
      "turn_loss": 0.108597531914711,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.15266679055937557,
      "grad_norm": 0.3879399001598358,
      "learning_rate": 8.34859977956471e-06,
      "loss": 0.1351,
      "mae_dtheta": 0.04252101108431816,
      "mae_dx": 0.014211582951247692,
      "mae_dy": 0.005850764457136393,
      "pose_mae_dtheta": 0.3810928761959076,
      "pose_mae_dx": 0.11669238656759262,
      "pose_mae_dy": 0.07446335256099701,
      "pose_rmse_dtheta": 0.6324816942214966,
      "pose_rmse_dx": 0.23815223574638367,
      "pose_rmse_dy": 0.16976837813854218,
      "pose_rmse_mean": 0.3468007743358612,
      "rmse_dtheta": 0.06159653142094612,
      "rmse_dx": 0.02714879997074604,
      "rmse_dy": 0.012836367823183537,
      "rmse_mean": 0.03386056795716286,
      "rotation_flip": 0.018282989040017128,
      "sparse_tokens": 21752.0,
      "step": 3286,
      "turn_loss": 0.3354918658733368,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15271325032521835,
      "grad_norm": 0.4390730559825897,
      "learning_rate": 8.347617764385714e-06,
      "loss": 0.1159,
      "mae_dtheta": 0.01058172807097435,
      "mae_dx": 0.001923333969898522,
      "mae_dy": 0.0035277772694826126,
      "pose_mae_dtheta": 0.07277166843414307,
      "pose_mae_dx": 0.0286648441106081,
      "pose_mae_dy": 0.03979333117604256,
      "pose_rmse_dtheta": 0.14442437887191772,
      "pose_rmse_dx": 0.06914383172988892,
      "pose_rmse_dy": 0.09605026245117188,
      "pose_rmse_mean": 0.10320615768432617,
      "rmse_dtheta": 0.019959114491939545,
      "rmse_dx": 0.005362989380955696,
      "rmse_dy": 0.007286249194294214,
      "rmse_mean": 0.010869450867176056,
      "rotation_flip": 0.004232804290950298,
      "sparse_tokens": 32105.0,
      "step": 3287,
      "turn_loss": 0.09635210782289505,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15275971009106115,
      "grad_norm": 0.47769972681999207,
      "learning_rate": 8.346635515106012e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.013884641230106354,
      "mae_dx": 0.0026945904828608036,
      "mae_dy": 0.003148663090541959,
      "pose_mae_dtheta": 0.09231638163328171,
      "pose_mae_dx": 0.029570112004876137,
      "pose_mae_dy": 0.03496600687503815,
      "pose_rmse_dtheta": 0.2037816047668457,
      "pose_rmse_dx": 0.07447171956300735,
      "pose_rmse_dy": 0.07446059584617615,
      "pose_rmse_mean": 0.11757130920886993,
      "rmse_dtheta": 0.02635606937110424,
      "rmse_dx": 0.008342494256794453,
      "rmse_dy": 0.0068311928771436214,
      "rmse_mean": 0.013843252323567867,
      "rotation_flip": 0.010384615510702133,
      "sparse_tokens": 32105.0,
      "step": 3288,
      "turn_loss": 0.11016809195280075,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.15280616985690393,
      "grad_norm": 0.48987844586372375,
      "learning_rate": 8.345653031794292e-06,
      "loss": 0.0967,
      "mae_dtheta": 0.008277609013020992,
      "mae_dx": 0.0013297218829393387,
      "mae_dy": 0.0018379216780886054,
      "pose_mae_dtheta": 0.06120770797133446,
      "pose_mae_dx": 0.019601915031671524,
      "pose_mae_dy": 0.02848185785114765,
      "pose_rmse_dtheta": 0.16472181677818298,
      "pose_rmse_dx": 0.05447503551840782,
      "pose_rmse_dy": 0.08924014866352081,
      "pose_rmse_mean": 0.10281233489513397,
      "rmse_dtheta": 0.02138865739107132,
      "rmse_dx": 0.003431747667491436,
      "rmse_dy": 0.004783617332577705,
      "rmse_mean": 0.009868008084595203,
      "rotation_flip": 0.0010752688394859433,
      "sparse_tokens": 32073.0,
      "step": 3289,
      "turn_loss": 0.06385692209005356,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1528526296227467,
      "grad_norm": 0.5871978402137756,
      "learning_rate": 8.34467031451926e-06,
      "loss": 0.0881,
      "mae_dtheta": 0.008612469770014286,
      "mae_dx": 0.003100832924246788,
      "mae_dy": 0.002791324397549033,
      "pose_mae_dtheta": 0.06816764175891876,
      "pose_mae_dx": 0.0373590849339962,
      "pose_mae_dy": 0.03280581161379814,
      "pose_rmse_dtheta": 0.16258201003074646,
      "pose_rmse_dx": 0.11062972247600555,
      "pose_rmse_dy": 0.0847899541258812,
      "pose_rmse_mean": 0.1193338930606842,
      "rmse_dtheta": 0.019748404622077942,
      "rmse_dx": 0.0086665078997612,
      "rmse_dy": 0.007810267154127359,
      "rmse_mean": 0.012075060978531837,
      "rotation_flip": 0.002337814075872302,
      "sparse_tokens": 32057.0,
      "step": 3290,
      "turn_loss": 0.09214367717504501,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.15289908938858948,
      "grad_norm": 0.8076766133308411,
      "learning_rate": 8.343687363349637e-06,
      "loss": 0.1417,
      "mae_dtheta": 0.009490209631621838,
      "mae_dx": 0.0018951052334159613,
      "mae_dy": 0.002247851574793458,
      "pose_mae_dtheta": 0.07314005494117737,
      "pose_mae_dx": 0.026998186483979225,
      "pose_mae_dy": 0.033467553555965424,
      "pose_rmse_dtheta": 0.1582353562116623,
      "pose_rmse_dx": 0.09127097576856613,
      "pose_rmse_dy": 0.08324875682592392,
      "pose_rmse_mean": 0.11091836541891098,
      "rmse_dtheta": 0.019051961600780487,
      "rmse_dx": 0.00714841578155756,
      "rmse_dy": 0.005979639943689108,
      "rmse_mean": 0.010726671665906906,
      "rotation_flip": 0.002742731710895896,
      "sparse_tokens": 32041.0,
      "step": 3291,
      "turn_loss": 0.07426554709672928,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15294554915443226,
      "grad_norm": 0.42358672618865967,
      "learning_rate": 8.342704178354163e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.007972483523190022,
      "mae_dx": 0.002115715527907014,
      "mae_dy": 0.0025733469519764185,
      "pose_mae_dtheta": 0.05660472437739372,
      "pose_mae_dx": 0.027785923331975937,
      "pose_mae_dy": 0.028956938534975052,
      "pose_rmse_dtheta": 0.10957702249288559,
      "pose_rmse_dx": 0.07993875443935394,
      "pose_rmse_dy": 0.06854142993688583,
      "pose_rmse_mean": 0.08601906895637512,
      "rmse_dtheta": 0.016490695998072624,
      "rmse_dx": 0.006358606740832329,
      "rmse_dy": 0.006570036057382822,
      "rmse_mean": 0.009806446731090546,
      "rotation_flip": 0.0038197096437215805,
      "sparse_tokens": 32121.0,
      "step": 3292,
      "turn_loss": 0.07011163979768753,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.15299200892027504,
      "grad_norm": 0.36463016271591187,
      "learning_rate": 8.34172075960159e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.009496417827904224,
      "mae_dx": 0.0015184306539595127,
      "mae_dy": 0.0015186459058895707,
      "pose_mae_dtheta": 0.0626060739159584,
      "pose_mae_dx": 0.018626146018505096,
      "pose_mae_dy": 0.017347488552331924,
      "pose_rmse_dtheta": 0.1923319697380066,
      "pose_rmse_dx": 0.045441824942827225,
      "pose_rmse_dy": 0.05101544409990311,
      "pose_rmse_mean": 0.09626308083534241,
      "rmse_dtheta": 0.02518700808286667,
      "rmse_dx": 0.004715039860457182,
      "rmse_dy": 0.003573731519281864,
      "rmse_mean": 0.011158592998981476,
      "rotation_flip": 0.0031474819406867027,
      "sparse_tokens": 32137.0,
      "step": 3293,
      "turn_loss": 0.07070495188236237,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1530384686861178,
      "grad_norm": 0.5819142460823059,
      "learning_rate": 8.34073710716069e-06,
      "loss": 0.1644,
      "mae_dtheta": 0.015119791962206364,
      "mae_dx": 0.0020834137685596943,
      "mae_dy": 0.003696231171488762,
      "pose_mae_dtheta": 0.10302957147359848,
      "pose_mae_dx": 0.035857103765010834,
      "pose_mae_dy": 0.04553934931755066,
      "pose_rmse_dtheta": 0.20523308217525482,
      "pose_rmse_dx": 0.08314118534326553,
      "pose_rmse_dy": 0.10571113228797913,
      "pose_rmse_mean": 0.13136181235313416,
      "rmse_dtheta": 0.028000090271234512,
      "rmse_dx": 0.005900650750845671,
      "rmse_dy": 0.007584296632558107,
      "rmse_mean": 0.013828346505761147,
      "rotation_flip": 0.00428418442606926,
      "sparse_tokens": 32057.0,
      "step": 3294,
      "turn_loss": 0.12272495031356812,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1530849284519606,
      "grad_norm": 0.5294063091278076,
      "learning_rate": 8.339753221100254e-06,
      "loss": 0.1175,
      "mae_dtheta": 0.012758295983076096,
      "mae_dx": 0.0032923438120633364,
      "mae_dy": 0.003146115690469742,
      "pose_mae_dtheta": 0.09249498695135117,
      "pose_mae_dx": 0.029155712574720383,
      "pose_mae_dy": 0.030195461586117744,
      "pose_rmse_dtheta": 0.21837905049324036,
      "pose_rmse_dx": 0.07296927273273468,
      "pose_rmse_dy": 0.0754416286945343,
      "pose_rmse_mean": 0.12226332724094391,
      "rmse_dtheta": 0.029494663700461388,
      "rmse_dx": 0.008674206212162971,
      "rmse_dy": 0.008314584381878376,
      "rmse_mean": 0.015494484454393387,
      "rotation_flip": 0.006242684554308653,
      "sparse_tokens": 32169.0,
      "step": 3295,
      "turn_loss": 0.1270875632762909,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1531313882178034,
      "grad_norm": 0.579778790473938,
      "learning_rate": 8.338769101489081e-06,
      "loss": 0.1608,
      "mae_dtheta": 0.00670568598434329,
      "mae_dx": 0.0014627495547756553,
      "mae_dy": 0.001024936093017459,
      "pose_mae_dtheta": 0.04658513888716698,
      "pose_mae_dx": 0.013891567476093769,
      "pose_mae_dy": 0.013574759475886822,
      "pose_rmse_dtheta": 0.13217434287071228,
      "pose_rmse_dx": 0.03242744877934456,
      "pose_rmse_dy": 0.03250359743833542,
      "pose_rmse_mean": 0.06570179760456085,
      "rmse_dtheta": 0.01851809024810791,
      "rmse_dx": 0.00398075208067894,
      "rmse_dy": 0.0026269038207829,
      "rmse_mean": 0.008375248871743679,
      "rotation_flip": 0.0010554089676588774,
      "sparse_tokens": 32153.0,
      "step": 3296,
      "turn_loss": 0.049072787165641785,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.15317784798364617,
      "grad_norm": 0.6679356694221497,
      "learning_rate": 8.337784748395992e-06,
      "loss": 0.1873,
      "mae_dtheta": 0.028579333797097206,
      "mae_dx": 0.005499835591763258,
      "mae_dy": 0.004715959541499615,
      "pose_mae_dtheta": 0.22632473707199097,
      "pose_mae_dx": 0.0527777262032032,
      "pose_mae_dy": 0.052908096462488174,
      "pose_rmse_dtheta": 0.4421233832836151,
      "pose_rmse_dx": 0.139159694314003,
      "pose_rmse_dy": 0.10352042317390442,
      "pose_rmse_mean": 0.2282678335905075,
      "rmse_dtheta": 0.045639581978321075,
      "rmse_dx": 0.015003747306764126,
      "rmse_dy": 0.008196499198675156,
      "rmse_mean": 0.022946611046791077,
      "rotation_flip": 0.02624671906232834,
      "sparse_tokens": 6713.0,
      "step": 3297,
      "turn_loss": 0.201908677816391,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15322430774948895,
      "grad_norm": 0.6362840533256531,
      "learning_rate": 8.336800161889827e-06,
      "loss": 0.1312,
      "mae_dtheta": 0.014291724190115929,
      "mae_dx": 0.002711039036512375,
      "mae_dy": 0.004299544729292393,
      "pose_mae_dtheta": 0.09471428394317627,
      "pose_mae_dx": 0.03486136347055435,
      "pose_mae_dy": 0.044157128781080246,
      "pose_rmse_dtheta": 0.19485744833946228,
      "pose_rmse_dx": 0.07985661178827286,
      "pose_rmse_dy": 0.10415923595428467,
      "pose_rmse_mean": 0.12629109621047974,
      "rmse_dtheta": 0.025153042748570442,
      "rmse_dx": 0.007308436091989279,
      "rmse_dy": 0.008772743865847588,
      "rmse_mean": 0.013744741678237915,
      "rotation_flip": 0.007013069931417704,
      "sparse_tokens": 32121.0,
      "step": 3298,
      "turn_loss": 0.14104141294956207,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.15327076751533172,
      "grad_norm": 0.5449913144111633,
      "learning_rate": 8.335815342039433e-06,
      "loss": 0.1496,
      "mae_dtheta": 0.03150000423192978,
      "mae_dx": 0.009422248229384422,
      "mae_dy": 0.0025020474568009377,
      "pose_mae_dtheta": 0.27525386214256287,
      "pose_mae_dx": 0.09276027977466583,
      "pose_mae_dy": 0.03589649125933647,
      "pose_rmse_dtheta": 0.5756447911262512,
      "pose_rmse_dx": 0.18924939632415771,
      "pose_rmse_dy": 0.1102800965309143,
      "pose_rmse_mean": 0.2917247712612152,
      "rmse_dtheta": 0.05631716549396515,
      "rmse_dx": 0.01977911964058876,
      "rmse_dy": 0.005587207619100809,
      "rmse_mean": 0.02722783014178276,
      "rotation_flip": 0.02389078587293625,
      "sparse_tokens": 5815.0,
      "step": 3299,
      "turn_loss": 0.18927058577537537,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 33310.0,
      "epoch": 0.1533172272811745,
      "grad_norm": 0.5572757720947266,
      "learning_rate": 8.334830288913681e-06,
      "loss": 0.1658,
      "mae_dtheta": 0.030858652666211128,
      "mae_dx": 0.010816738940775394,
      "mae_dy": 0.005904850549995899,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5572758316993713,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 140.9607696533203,
      "model/head/act_norm_mean": 102.02798847087378,
      "model/head/act_norm_min": 70.41937255859375,
      "model/head/act_over_embed": 70.11458887826197,
      "model/head/grad_frac": 0.1021735891699791,
      "model/head/grad_norm": 0.05693887174129486,
      "model/head/grad_zero_frac": 0.00020527483138721436,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6928853155339806,
      "model/head/update_ratio": 0.0009813683573156595,
      "model/head/weight_delta": 6.7469611167907715,
      "model/head/weight_delta_rel": 0.11836168169975281,
      "model/head/weight_norm": 58.01987838745117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41662898659706116,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41662898659706116,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41662898659706116,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.286311340131527,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07482203841209412,
      "model/modality_embedder.encoders.pose/grad_norm": 0.041696514934301376,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013521600048989058,
      "model/modality_embedder.encoders.pose/weight_delta": 2.2159743309020996,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07240279018878937,
      "model/modality_embedder.encoders.pose/weight_norm": 30.83696746826172,
      "model/modality_embedder/grad_frac": 0.07482203841209412,
      "model/modality_embedder/grad_norm": 0.041696514934301376,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0013521600048989058,
      "model/modality_embedder/weight_delta": 2.2159743309020996,
      "model/modality_embedder/weight_delta_rel": 0.07240279018878937,
      "model/modality_embedder/weight_norm": 30.83696746826172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.59580993652344,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.712853001232855,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.205709457397461,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.60848522352723,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07329201698303223,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04084387049078941,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014744518557563424,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.511286735534668,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.055072199553251266,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.701053619384766,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.37103271484375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.585341539528432,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.6509370803833,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.20806751541034,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07676247507333755,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04277787357568741,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001458209240809083,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.9051380157470703,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0659954696893692,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.335895538330078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 76.22881317138672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.27002427184466,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.268728256225586,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.36579726130629,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0797833800315857,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04446135088801384,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014682731125503778,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.042877674102783,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0685960054397583,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.281391143798828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.35228729248047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.231690167976577,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.918128967285156,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.713872430533613,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0891086608171463,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04965810105204582,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016765996115282178,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.7429338693618774,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05956520885229111,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.61834144592285,
      "model/normalizer/grad_frac": 0.3384952247142792,
      "model/normalizer/grad_norm": 0.1886352151632309,
      "model/normalizer/grad_zero_frac": 0.00022453030396718532,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0024131429381668568,
      "model/normalizer/weight_delta": 3.708021640777588,
      "model/normalizer/weight_delta_rel": 0.04775717109441757,
      "model/normalizer/weight_norm": 78.16992950439453,
      "pose_mae_dtheta": 0.2514561414718628,
      "pose_mae_dx": 0.09408016502857208,
      "pose_mae_dy": 0.0666070431470871,
      "pose_rmse_dtheta": 0.4432196319103241,
      "pose_rmse_dx": 0.21050390601158142,
      "pose_rmse_dy": 0.15916335582733154,
      "pose_rmse_mean": 0.27096229791641235,
      "rmse_dtheta": 0.04815583676099777,
      "rmse_dx": 0.022373972460627556,
      "rmse_dy": 0.012406880967319012,
      "rmse_mean": 0.027645563706755638,
      "rotation_flip": 0.01701570674777031,
      "sparse_tokens": 26654.0,
      "step": 3300,
      "turn_loss": 0.2545234262943268,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15336368704701728,
      "grad_norm": 0.46400192379951477,
      "learning_rate": 8.33384500258146e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.0119409691542387,
      "mae_dx": 0.002241262700408697,
      "mae_dy": 0.0030578093137592077,
      "pose_mae_dtheta": 0.08950608223676682,
      "pose_mae_dx": 0.031707264482975006,
      "pose_mae_dy": 0.03708070516586304,
      "pose_rmse_dtheta": 0.2154550850391388,
      "pose_rmse_dx": 0.07848936319351196,
      "pose_rmse_dy": 0.09246940165758133,
      "pose_rmse_mean": 0.12880462408065796,
      "rmse_dtheta": 0.025831736624240875,
      "rmse_dx": 0.0064314077608287334,
      "rmse_dy": 0.006751846522092819,
      "rmse_mean": 0.013004997745156288,
      "rotation_flip": 0.014609203673899174,
      "sparse_tokens": 32121.0,
      "step": 3301,
      "turn_loss": 0.09987348318099976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.15341014681286005,
      "grad_norm": 0.45143449306488037,
      "learning_rate": 8.332859483111666e-06,
      "loss": 0.1093,
      "mae_dtheta": 0.009638046845793724,
      "mae_dx": 0.0023301108740270138,
      "mae_dy": 0.002466244623064995,
      "pose_mae_dtheta": 0.06553635746240616,
      "pose_mae_dx": 0.024230502545833588,
      "pose_mae_dy": 0.024487268179655075,
      "pose_rmse_dtheta": 0.17240169644355774,
      "pose_rmse_dx": 0.07527726143598557,
      "pose_rmse_dy": 0.060529183596372604,
      "pose_rmse_mean": 0.10273604840040207,
      "rmse_dtheta": 0.022371595725417137,
      "rmse_dx": 0.007628214079886675,
      "rmse_dy": 0.006347501650452614,
      "rmse_mean": 0.01211577095091343,
      "rotation_flip": 0.006651884876191616,
      "sparse_tokens": 32137.0,
      "step": 3302,
      "turn_loss": 0.08480549603700638,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.15345660657870283,
      "grad_norm": 0.695580244064331,
      "learning_rate": 8.331873730573222e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.011883054859936237,
      "mae_dx": 0.0027778155636042356,
      "mae_dy": 0.002969813533127308,
      "pose_mae_dtheta": 0.09445115178823471,
      "pose_mae_dx": 0.037268973886966705,
      "pose_mae_dy": 0.036841027438640594,
      "pose_rmse_dtheta": 0.2435690313577652,
      "pose_rmse_dx": 0.11762264370918274,
      "pose_rmse_dy": 0.08999533951282501,
      "pose_rmse_mean": 0.15039567649364471,
      "rmse_dtheta": 0.026275228708982468,
      "rmse_dx": 0.00890256091952324,
      "rmse_dy": 0.00737852044403553,
      "rmse_mean": 0.014185436069965363,
      "rotation_flip": 0.003733084537088871,
      "sparse_tokens": 32073.0,
      "step": 3303,
      "turn_loss": 0.10579490661621094,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.15350306634454564,
      "grad_norm": 0.6667653322219849,
      "learning_rate": 8.330887745035057e-06,
      "loss": 0.1572,
      "mae_dtheta": 0.01193030271679163,
      "mae_dx": 0.0021833644714206457,
      "mae_dy": 0.004118314944207668,
      "pose_mae_dtheta": 0.08092781901359558,
      "pose_mae_dx": 0.029249893501400948,
      "pose_mae_dy": 0.04607431963086128,
      "pose_rmse_dtheta": 0.15851841866970062,
      "pose_rmse_dx": 0.07649412751197815,
      "pose_rmse_dy": 0.12005554139614105,
      "pose_rmse_mean": 0.11835603415966034,
      "rmse_dtheta": 0.021201003342866898,
      "rmse_dx": 0.006524096708744764,
      "rmse_dy": 0.01018686406314373,
      "rmse_mean": 0.012637322768568993,
      "rotation_flip": 0.004219409078359604,
      "sparse_tokens": 32073.0,
      "step": 3304,
      "turn_loss": 0.11643284559249878,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1535495261103884,
      "grad_norm": 0.5036457777023315,
      "learning_rate": 8.329901526566125e-06,
      "loss": 0.089,
      "mae_dtheta": 0.00387725536711514,
      "mae_dx": 0.0053230347111821175,
      "mae_dy": 0.0003890677762683481,
      "pose_mae_dtheta": 0.028558960184454918,
      "pose_mae_dx": 0.040525633841753006,
      "pose_mae_dy": 0.00670645572245121,
      "pose_rmse_dtheta": 0.1202717125415802,
      "pose_rmse_dx": 0.15442772209644318,
      "pose_rmse_dy": 0.01040832418948412,
      "pose_rmse_mean": 0.09503592550754547,
      "rmse_dtheta": 0.014535756781697273,
      "rmse_dx": 0.01659742370247841,
      "rmse_dy": 0.0005966557073406875,
      "rmse_mean": 0.010576612316071987,
      "rotation_flip": 0.0024509804788976908,
      "sparse_tokens": 32057.0,
      "step": 3305,
      "turn_loss": 0.05063584819436073,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1535959858762312,
      "grad_norm": 0.5420078039169312,
      "learning_rate": 8.328915075235393e-06,
      "loss": 0.0964,
      "mae_dtheta": 0.008838511072099209,
      "mae_dx": 0.0017815286992117763,
      "mae_dy": 0.0018021108116954565,
      "pose_mae_dtheta": 0.06559399515390396,
      "pose_mae_dx": 0.02021675556898117,
      "pose_mae_dy": 0.025477223098278046,
      "pose_rmse_dtheta": 0.16592982411384583,
      "pose_rmse_dx": 0.04761882498860359,
      "pose_rmse_dy": 0.05836956948041916,
      "pose_rmse_mean": 0.09063940495252609,
      "rmse_dtheta": 0.018781153485178947,
      "rmse_dx": 0.005710298661142588,
      "rmse_dy": 0.004192323889583349,
      "rmse_mean": 0.009561259299516678,
      "rotation_flip": 0.0033402922563254833,
      "sparse_tokens": 32105.0,
      "step": 3306,
      "turn_loss": 0.07745516300201416,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.15364244564207397,
      "grad_norm": 0.510766863822937,
      "learning_rate": 8.327928391111841e-06,
      "loss": 0.0953,
      "mae_dtheta": 0.027549810707569122,
      "mae_dx": 0.014905495569109917,
      "mae_dy": 0.0036537013947963715,
      "pose_mae_dtheta": 0.20514999330043793,
      "pose_mae_dx": 0.11309193074703217,
      "pose_mae_dy": 0.05632885545492172,
      "pose_rmse_dtheta": 0.43344634771347046,
      "pose_rmse_dx": 0.28188356757164,
      "pose_rmse_dy": 0.14413852989673615,
      "pose_rmse_mean": 0.28648948669433594,
      "rmse_dtheta": 0.04779661446809769,
      "rmse_dx": 0.030617302283644676,
      "rmse_dy": 0.007676536682993174,
      "rmse_mean": 0.0286968182772398,
      "rotation_flip": 0.004535147454589605,
      "sparse_tokens": 9250.0,
      "step": 3307,
      "turn_loss": 0.19700783491134644,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15368890540791674,
      "grad_norm": 0.5942017436027527,
      "learning_rate": 8.326941474264471e-06,
      "loss": 0.1613,
      "mae_dtheta": 0.006136345211416483,
      "mae_dx": 0.0015520210145041347,
      "mae_dy": 0.0011186570627614856,
      "pose_mae_dtheta": 0.042217765003442764,
      "pose_mae_dx": 0.015729548409581184,
      "pose_mae_dy": 0.016028176993131638,
      "pose_rmse_dtheta": 0.11947916448116302,
      "pose_rmse_dx": 0.044666942209005356,
      "pose_rmse_dy": 0.05071132630109787,
      "pose_rmse_mean": 0.07161914557218552,
      "rmse_dtheta": 0.016942961141467094,
      "rmse_dx": 0.005259107798337936,
      "rmse_dy": 0.0027450951747596264,
      "rmse_mean": 0.008315721526741982,
      "rotation_flip": 0.009548058733344078,
      "sparse_tokens": 32089.0,
      "step": 3308,
      "turn_loss": 0.05646064132452011,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15373536517375952,
      "grad_norm": 0.38308215141296387,
      "learning_rate": 8.3259543247623e-06,
      "loss": 0.1068,
      "mae_dtheta": 0.007182271685451269,
      "mae_dx": 0.002378269797191024,
      "mae_dy": 0.0018721099477261305,
      "pose_mae_dtheta": 0.05701906234025955,
      "pose_mae_dx": 0.019458765164017677,
      "pose_mae_dy": 0.019788002595305443,
      "pose_rmse_dtheta": 0.16655494272708893,
      "pose_rmse_dx": 0.053716499358415604,
      "pose_rmse_dy": 0.04985921084880829,
      "pose_rmse_mean": 0.09004354476928711,
      "rmse_dtheta": 0.020913323387503624,
      "rmse_dx": 0.007652608212083578,
      "rmse_dy": 0.0064971065148711205,
      "rmse_mean": 0.011687680147588253,
      "rotation_flip": 0.010495626367628574,
      "sparse_tokens": 32089.0,
      "step": 3309,
      "turn_loss": 0.09482907503843307,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.1537818249396023,
      "grad_norm": 0.48957890272140503,
      "learning_rate": 8.324966942674357e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.026656724512577057,
      "mae_dx": 0.00937646720558405,
      "mae_dy": 0.003657481400296092,
      "pose_mae_dtheta": 0.21520790457725525,
      "pose_mae_dx": 0.07083378732204437,
      "pose_mae_dy": 0.03962421789765358,
      "pose_rmse_dtheta": 0.396469384431839,
      "pose_rmse_dx": 0.15536147356033325,
      "pose_rmse_dy": 0.09803743660449982,
      "pose_rmse_mean": 0.21662276983261108,
      "rmse_dtheta": 0.044806625694036484,
      "rmse_dx": 0.02091825194656849,
      "rmse_dy": 0.006570225115865469,
      "rmse_mean": 0.024098370224237442,
      "rotation_flip": 0.00522193219512701,
      "sparse_tokens": 6444.0,
      "step": 3310,
      "turn_loss": 0.2219143509864807,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.15382828470544507,
      "grad_norm": 1.5549129247665405,
      "learning_rate": 8.323979328069689e-06,
      "loss": 0.2883,
      "mae_dtheta": 0.02704787254333496,
      "mae_dx": 0.00738504296168685,
      "mae_dy": 0.004733432549983263,
      "pose_mae_dtheta": 0.2116258144378662,
      "pose_mae_dx": 0.05571337044239044,
      "pose_mae_dy": 0.0845017060637474,
      "pose_rmse_dtheta": 0.4226425886154175,
      "pose_rmse_dx": 0.13011081516742706,
      "pose_rmse_dy": 0.1519085168838501,
      "pose_rmse_mean": 0.23488730192184448,
      "rmse_dtheta": 0.04360362887382507,
      "rmse_dx": 0.01937456615269184,
      "rmse_dy": 0.006859293207526207,
      "rmse_mean": 0.023279163986444473,
      "rotation_flip": 0.014084506779909134,
      "sparse_tokens": 4087.0,
      "step": 3311,
      "turn_loss": 0.23033377528190613,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.15387474447128788,
      "grad_norm": 0.77471524477005,
      "learning_rate": 8.322991481017365e-06,
      "loss": 0.2569,
      "mae_dtheta": 0.044321198016405106,
      "mae_dx": 0.011305398307740688,
      "mae_dy": 0.0043688006699085236,
      "pose_mae_dtheta": 0.3709699511528015,
      "pose_mae_dx": 0.08743806928396225,
      "pose_mae_dy": 0.053431518375873566,
      "pose_rmse_dtheta": 0.6268399357795715,
      "pose_rmse_dx": 0.22460594773292542,
      "pose_rmse_dy": 0.14089146256446838,
      "pose_rmse_mean": 0.33077913522720337,
      "rmse_dtheta": 0.06401825696229935,
      "rmse_dx": 0.024200184270739555,
      "rmse_dy": 0.009146933443844318,
      "rmse_mean": 0.03245512768626213,
      "rotation_flip": 0.006065201014280319,
      "sparse_tokens": 17774.0,
      "step": 3312,
      "turn_loss": 0.29484838247299194,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 24989.0,
      "epoch": 0.15392120423713065,
      "grad_norm": 0.6876867413520813,
      "learning_rate": 8.322003401586463e-06,
      "loss": 0.1619,
      "mae_dtheta": 0.03728374466300011,
      "mae_dx": 0.010519800707697868,
      "mae_dy": 0.004630445968359709,
      "pose_mae_dtheta": 0.2914623022079468,
      "pose_mae_dx": 0.09667693078517914,
      "pose_mae_dy": 0.04270113632082939,
      "pose_rmse_dtheta": 0.5084141492843628,
      "pose_rmse_dx": 0.2000771313905716,
      "pose_rmse_dy": 0.10535725206136703,
      "pose_rmse_mean": 0.2712828516960144,
      "rmse_dtheta": 0.05667576566338539,
      "rmse_dx": 0.020373042672872543,
      "rmse_dy": 0.010551820509135723,
      "rmse_mean": 0.02920020930469036,
      "rotation_flip": 0.011618257500231266,
      "sparse_tokens": 19045.0,
      "step": 3313,
      "turn_loss": 0.29747486114501953,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 33738.0,
      "epoch": 0.15396766400297343,
      "grad_norm": 1.028909683227539,
      "learning_rate": 8.321015089846079e-06,
      "loss": 0.317,
      "mae_dtheta": 0.03697602450847626,
      "mae_dx": 0.01255832239985466,
      "mae_dy": 0.008016841486096382,
      "pose_mae_dtheta": 0.26610758900642395,
      "pose_mae_dx": 0.09292352944612503,
      "pose_mae_dy": 0.08416052907705307,
      "pose_rmse_dtheta": 0.4379217028617859,
      "pose_rmse_dx": 0.20987831056118011,
      "pose_rmse_dy": 0.1755482405424118,
      "pose_rmse_mean": 0.2744494378566742,
      "rmse_dtheta": 0.05318006873130798,
      "rmse_dx": 0.02484798990190029,
      "rmse_dy": 0.015143281780183315,
      "rmse_mean": 0.031057115644216537,
      "rotation_flip": 0.014032946899533272,
      "sparse_tokens": 26511.0,
      "step": 3314,
      "turn_loss": 0.37101930379867554,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1540141237688162,
      "grad_norm": 0.5334377884864807,
      "learning_rate": 8.320026545865327e-06,
      "loss": 0.1238,
      "mae_dtheta": 0.01037534698843956,
      "mae_dx": 0.0016089235432446003,
      "mae_dy": 0.002146798884496093,
      "pose_mae_dtheta": 0.06529410928487778,
      "pose_mae_dx": 0.022462895140051842,
      "pose_mae_dy": 0.0298759862780571,
      "pose_rmse_dtheta": 0.12985524535179138,
      "pose_rmse_dx": 0.053510867059230804,
      "pose_rmse_dy": 0.07388851791620255,
      "pose_rmse_mean": 0.08575154840946198,
      "rmse_dtheta": 0.02136407233774662,
      "rmse_dx": 0.004716656170785427,
      "rmse_dy": 0.0045714410953223705,
      "rmse_mean": 0.010217390023171902,
      "rotation_flip": 0.005036807619035244,
      "sparse_tokens": 32153.0,
      "step": 3315,
      "turn_loss": 0.08168753981590271,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.15406058353465898,
      "grad_norm": 0.5095038414001465,
      "learning_rate": 8.319037769713338e-06,
      "loss": 0.1872,
      "mae_dtheta": 0.04461776465177536,
      "mae_dx": 0.018438613042235374,
      "mae_dy": 0.0076155648566782475,
      "pose_mae_dtheta": 0.3591514825820923,
      "pose_mae_dx": 0.16810835897922516,
      "pose_mae_dy": 0.07035185396671295,
      "pose_rmse_dtheta": 0.5722503066062927,
      "pose_rmse_dx": 0.3302372694015503,
      "pose_rmse_dy": 0.17640550434589386,
      "pose_rmse_mean": 0.3596310317516327,
      "rmse_dtheta": 0.06258741766214371,
      "rmse_dx": 0.03183092176914215,
      "rmse_dy": 0.01565045490860939,
      "rmse_mean": 0.036689601838588715,
      "rotation_flip": 0.014681892469525337,
      "sparse_tokens": 20363.0,
      "step": 3316,
      "turn_loss": 0.40636155009269714,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.15410704330050176,
      "grad_norm": 0.4696415662765503,
      "learning_rate": 8.318048761459257e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.041534289717674255,
      "mae_dx": 0.009174719452857971,
      "mae_dy": 0.007711089216172695,
      "pose_mae_dtheta": 0.3516346216201782,
      "pose_mae_dx": 0.06416399776935577,
      "pose_mae_dy": 0.06527627259492874,
      "pose_rmse_dtheta": 0.5801558494567871,
      "pose_rmse_dx": 0.1342112272977829,
      "pose_rmse_dy": 0.16714298725128174,
      "pose_rmse_mean": 0.29383671283721924,
      "rmse_dtheta": 0.06108073145151138,
      "rmse_dx": 0.019188977777957916,
      "rmse_dy": 0.019557969644665718,
      "rmse_mean": 0.033275894820690155,
      "rotation_flip": 0.015594542026519775,
      "sparse_tokens": 8944.0,
      "step": 3317,
      "turn_loss": 0.41143232583999634,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.15415350306634454,
      "grad_norm": 0.4288853406906128,
      "learning_rate": 8.317059521172242e-06,
      "loss": 0.119,
      "mae_dtheta": 0.032579757273197174,
      "mae_dx": 0.011786562390625477,
      "mae_dy": 0.0023028263822197914,
      "pose_mae_dtheta": 0.2400006651878357,
      "pose_mae_dx": 0.08472244441509247,
      "pose_mae_dy": 0.02794165164232254,
      "pose_rmse_dtheta": 0.40888774394989014,
      "pose_rmse_dx": 0.19336165487766266,
      "pose_rmse_dy": 0.07387546449899673,
      "pose_rmse_mean": 0.2253749668598175,
      "rmse_dtheta": 0.050651539117097855,
      "rmse_dx": 0.02422531135380268,
      "rmse_dy": 0.004856509156525135,
      "rmse_mean": 0.026577789336442947,
      "rotation_flip": 0.008561643771827221,
      "sparse_tokens": 11001.0,
      "step": 3318,
      "turn_loss": 0.21934516727924347,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 25313.0,
      "epoch": 0.15419996283218732,
      "grad_norm": 0.8532838225364685,
      "learning_rate": 8.316070048921477e-06,
      "loss": 0.2064,
      "mae_dtheta": 0.03396739438176155,
      "mae_dx": 0.008201605640351772,
      "mae_dy": 0.003830333473160863,
      "pose_mae_dtheta": 0.2538723647594452,
      "pose_mae_dx": 0.06684630364179611,
      "pose_mae_dy": 0.04032500460743904,
      "pose_rmse_dtheta": 0.40875881910324097,
      "pose_rmse_dx": 0.15464550256729126,
      "pose_rmse_dy": 0.08946040272712708,
      "pose_rmse_mean": 0.2176215648651123,
      "rmse_dtheta": 0.05007803067564964,
      "rmse_dx": 0.017832927405834198,
      "rmse_dy": 0.007592909503728151,
      "rmse_mean": 0.025167955085635185,
      "rotation_flip": 0.026025237515568733,
      "sparse_tokens": 21058.0,
      "step": 3319,
      "turn_loss": 0.25347426533699036,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15424642259803012,
      "grad_norm": 0.4028325378894806,
      "learning_rate": 8.315080344776153e-06,
      "loss": 0.1001,
      "mae_dtheta": 0.011113974265754223,
      "mae_dx": 0.002142511773854494,
      "mae_dy": 0.0030906570609658957,
      "pose_mae_dtheta": 0.0687960535287857,
      "pose_mae_dx": 0.030233126133680344,
      "pose_mae_dy": 0.02981514297425747,
      "pose_rmse_dtheta": 0.14558696746826172,
      "pose_rmse_dx": 0.09170009940862656,
      "pose_rmse_dy": 0.06403801590204239,
      "pose_rmse_mean": 0.10044169425964355,
      "rmse_dtheta": 0.021757643669843674,
      "rmse_dx": 0.006165166851133108,
      "rmse_dy": 0.007092211861163378,
      "rmse_mean": 0.011671675369143486,
      "rotation_flip": 0.009451108984649181,
      "sparse_tokens": 32105.0,
      "step": 3320,
      "turn_loss": 0.09596606343984604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1542928823638729,
      "grad_norm": 0.32772696018218994,
      "learning_rate": 8.314090408805481e-06,
      "loss": 0.083,
      "mae_dtheta": 0.01155228540301323,
      "mae_dx": 0.0016495020827278495,
      "mae_dy": 0.0023066785652190447,
      "pose_mae_dtheta": 0.07993118464946747,
      "pose_mae_dx": 0.02370714209973812,
      "pose_mae_dy": 0.02797490917146206,
      "pose_rmse_dtheta": 0.23917467892169952,
      "pose_rmse_dx": 0.062481269240379333,
      "pose_rmse_dy": 0.07235948741436005,
      "pose_rmse_mean": 0.1246718168258667,
      "rmse_dtheta": 0.02729249745607376,
      "rmse_dx": 0.004742254037410021,
      "rmse_dy": 0.005185098387300968,
      "rmse_mean": 0.012406616471707821,
      "rotation_flip": 0.004684684798121452,
      "sparse_tokens": 32121.0,
      "step": 3321,
      "turn_loss": 0.08499424159526825,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.15433934212971567,
      "grad_norm": 0.7243663668632507,
      "learning_rate": 8.313100241078689e-06,
      "loss": 0.1335,
      "mae_dtheta": 0.009335658513009548,
      "mae_dx": 0.0014264933997765183,
      "mae_dy": 0.0015430253697559237,
      "pose_mae_dtheta": 0.057102277874946594,
      "pose_mae_dx": 0.017080696299672127,
      "pose_mae_dy": 0.018901541829109192,
      "pose_rmse_dtheta": 0.14716701209545135,
      "pose_rmse_dx": 0.04113450273871422,
      "pose_rmse_dy": 0.04691622778773308,
      "pose_rmse_mean": 0.07840591669082642,
      "rmse_dtheta": 0.023014532402157784,
      "rmse_dx": 0.004198780748993158,
      "rmse_dy": 0.0036147432401776314,
      "rmse_mean": 0.010276018641889095,
      "rotation_flip": 0.003930817823857069,
      "sparse_tokens": 32153.0,
      "step": 3322,
      "turn_loss": 0.06352683901786804,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.15438580189555845,
      "grad_norm": 0.5447707176208496,
      "learning_rate": 8.312109841665017e-06,
      "loss": 0.1391,
      "mae_dtheta": 0.039008978754282,
      "mae_dx": 0.012610923498868942,
      "mae_dy": 0.0070616998709738255,
      "pose_mae_dtheta": 0.31453871726989746,
      "pose_mae_dx": 0.0922514945268631,
      "pose_mae_dy": 0.052034590393304825,
      "pose_rmse_dtheta": 0.5144280791282654,
      "pose_rmse_dx": 0.1943596452474594,
      "pose_rmse_dy": 0.14719101786613464,
      "pose_rmse_mean": 0.2853262424468994,
      "rmse_dtheta": 0.05648886784911156,
      "rmse_dx": 0.023153966292738914,
      "rmse_dy": 0.016954835504293442,
      "rmse_mean": 0.032199226319789886,
      "rotation_flip": 0.02454991824924946,
      "sparse_tokens": 10279.0,
      "step": 3323,
      "turn_loss": 0.3834768831729889,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.15443226166140123,
      "grad_norm": 0.6817013025283813,
      "learning_rate": 8.311119210633727e-06,
      "loss": 0.1726,
      "mae_dtheta": 0.0455198809504509,
      "mae_dx": 0.011755147017538548,
      "mae_dy": 0.007243538741022348,
      "pose_mae_dtheta": 0.3864116966724396,
      "pose_mae_dx": 0.12057417631149292,
      "pose_mae_dy": 0.05277641490101814,
      "pose_rmse_dtheta": 0.6989734768867493,
      "pose_rmse_dx": 0.25239312648773193,
      "pose_rmse_dy": 0.14700666069984436,
      "pose_rmse_mean": 0.3661244511604309,
      "rmse_dtheta": 0.06883491575717926,
      "rmse_dx": 0.022630248218774796,
      "rmse_dy": 0.01745877042412758,
      "rmse_mean": 0.03630797564983368,
      "rotation_flip": 0.010822511278092861,
      "sparse_tokens": 7897.0,
      "step": 3324,
      "turn_loss": 0.3521314859390259,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.154478721427244,
      "grad_norm": 0.41305625438690186,
      "learning_rate": 8.310128348054093e-06,
      "loss": 0.1087,
      "mae_dtheta": 0.012253262102603912,
      "mae_dx": 0.002011219970881939,
      "mae_dy": 0.0026088908780366182,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.41305631399154663,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.6645050048828,
      "model/head/act_norm_mean": 111.63299005681819,
      "model/head/act_norm_min": 60.01500701904297,
      "model/head/act_over_embed": 76.71523589156457,
      "model/head/grad_frac": 0.1263931840658188,
      "model/head/grad_norm": 0.05220750346779823,
      "model/head/grad_zero_frac": 0.0002087648317683488,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6936503708964646,
      "model/head/update_ratio": 0.0008997170371003449,
      "model/head/weight_delta": 6.769155025482178,
      "model/head/weight_delta_rel": 0.11875102669000626,
      "model/head/weight_norm": 58.026580810546875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4167724549770355,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4166736024798769,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4166140854358673,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2863420005838984,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09611605107784271,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03970134258270264,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5442031926406926,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012873905943706632,
      "model/modality_embedder.encoders.pose/weight_delta": 2.2269656658172607,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0727619081735611,
      "model/modality_embedder.encoders.pose/weight_norm": 30.838613510131836,
      "model/modality_embedder/grad_frac": 0.09611605107784271,
      "model/modality_embedder/grad_norm": 0.03970134258270264,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5442031926406926,
      "model/modality_embedder/update_ratio": 0.0012873905943706632,
      "model/modality_embedder/weight_delta": 2.2269656658172607,
      "model/modality_embedder/weight_delta_rel": 0.0727619081735611,
      "model/modality_embedder/weight_norm": 30.838613510131836,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.95289611816406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.746257215007216,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.115917205810547,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.31865027411565,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09220778942108154,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03808701038360596,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001374860294163227,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.5192183256149292,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05536123365163803,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.70245933532715,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.93936920166016,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.8482543690877,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.385068893432617,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.075953035459666,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09677592664957047,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0399739071726799,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013625066494569182,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.9159142971038818,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06636876612901688,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.338504791259766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.9417495727539,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.7728851010101,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.299386024475098,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.39857729311354,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11151646822690964,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04606258124113083,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001520998659543693,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.0543599128723145,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06898155808448792,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.284433364868164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.60684204101562,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.619944484527817,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.012815475463867,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.667893793909307,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1402718722820282,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05794018134474754,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019560474902391434,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.7537400722503662,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.05993451178073883,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.621051788330078,
      "model/normalizer/grad_frac": 0.5374162793159485,
      "model/normalizer/grad_norm": 0.2219831794500351,
      "model/normalizer/grad_zero_frac": 0.0001902598887681961,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0028396279085427523,
      "model/normalizer/weight_delta": 3.7293691635131836,
      "model/normalizer/weight_delta_rel": 0.048032116144895554,
      "model/normalizer/weight_norm": 78.17333221435547,
      "pose_mae_dtheta": 0.08101357519626617,
      "pose_mae_dx": 0.020553676411509514,
      "pose_mae_dy": 0.02577485702931881,
      "pose_rmse_dtheta": 0.2233574390411377,
      "pose_rmse_dx": 0.05029299855232239,
      "pose_rmse_dy": 0.06223183497786522,
      "pose_rmse_mean": 0.1119607612490654,
      "rmse_dtheta": 0.028511518612504005,
      "rmse_dx": 0.005842080805450678,
      "rmse_dy": 0.0057204244658350945,
      "rmse_mean": 0.013358008116483688,
      "rotation_flip": 0.012387387454509735,
      "sparse_tokens": 32169.0,
      "step": 3325,
      "turn_loss": 0.09476639330387115,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.15452518119308678,
      "grad_norm": 0.5305575728416443,
      "learning_rate": 8.309137253995407e-06,
      "loss": 0.1628,
      "mae_dtheta": 0.00852014310657978,
      "mae_dx": 0.002871721051633358,
      "mae_dy": 0.0015507113421335816,
      "pose_mae_dtheta": 0.06564709544181824,
      "pose_mae_dx": 0.02960817702114582,
      "pose_mae_dy": 0.02398274466395378,
      "pose_rmse_dtheta": 0.19069059193134308,
      "pose_rmse_dx": 0.0902952030301094,
      "pose_rmse_dy": 0.06576915830373764,
      "pose_rmse_mean": 0.11558499187231064,
      "rmse_dtheta": 0.02165967784821987,
      "rmse_dx": 0.010340091772377491,
      "rmse_dy": 0.0035393519792705774,
      "rmse_mean": 0.011846374720335007,
      "rotation_flip": 0.0009496675920672715,
      "sparse_tokens": 32073.0,
      "step": 3326,
      "turn_loss": 0.10102836787700653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.15457164095892956,
      "grad_norm": 0.5044490694999695,
      "learning_rate": 8.308145928526979e-06,
      "loss": 0.1434,
      "mae_dtheta": 0.04727743938565254,
      "mae_dx": 0.010493818670511246,
      "mae_dy": 0.003300619078800082,
      "pose_mae_dtheta": 0.4397507309913635,
      "pose_mae_dx": 0.08316518366336823,
      "pose_mae_dy": 0.05785660818219185,
      "pose_rmse_dtheta": 0.7264817953109741,
      "pose_rmse_dx": 0.18340568244457245,
      "pose_rmse_dy": 0.15765109658241272,
      "pose_rmse_mean": 0.35584622621536255,
      "rmse_dtheta": 0.07003715634346008,
      "rmse_dx": 0.022761309519410133,
      "rmse_dy": 0.006507825572043657,
      "rmse_mean": 0.03310209885239601,
      "rotation_flip": 0.015384615398943424,
      "sparse_tokens": 6024.0,
      "step": 3327,
      "turn_loss": 0.3029433488845825,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 8761.0,
      "epoch": 0.15461810072477233,
      "grad_norm": 0.6493842005729675,
      "learning_rate": 8.307154371718127e-06,
      "loss": 0.1848,
      "mae_dtheta": 0.02421550080180168,
      "mae_dx": 0.009350654669106007,
      "mae_dy": 0.0045163254253566265,
      "pose_mae_dtheta": 0.1950734555721283,
      "pose_mae_dx": 0.07368412613868713,
      "pose_mae_dy": 0.08541727066040039,
      "pose_rmse_dtheta": 0.32191863656044006,
      "pose_rmse_dx": 0.16488772630691528,
      "pose_rmse_dy": 0.15239347517490387,
      "pose_rmse_mean": 0.21306662261486053,
      "rmse_dtheta": 0.03680088743567467,
      "rmse_dx": 0.020296454429626465,
      "rmse_dy": 0.007000739686191082,
      "rmse_mean": 0.021366028115153313,
      "rotation_flip": 0.017241379246115685,
      "sparse_tokens": 6874.0,
      "step": 3328,
      "turn_loss": 0.15212632715702057,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.15466456049061514,
      "grad_norm": 0.527557909488678,
      "learning_rate": 8.306162583638197e-06,
      "loss": 0.1253,
      "mae_dtheta": 0.010629856027662754,
      "mae_dx": 0.0036069799680262804,
      "mae_dy": 0.001809408888220787,
      "pose_mae_dtheta": 0.08204466104507446,
      "pose_mae_dx": 0.0366564504802227,
      "pose_mae_dy": 0.02617701329290867,
      "pose_rmse_dtheta": 0.22327497601509094,
      "pose_rmse_dx": 0.12081336975097656,
      "pose_rmse_dy": 0.06881923228502274,
      "pose_rmse_mean": 0.13763585686683655,
      "rmse_dtheta": 0.02571343630552292,
      "rmse_dx": 0.011840148828923702,
      "rmse_dy": 0.005543719977140427,
      "rmse_mean": 0.014365768991410732,
      "rotation_flip": 0.007348029408603907,
      "sparse_tokens": 32057.0,
      "step": 3329,
      "turn_loss": 0.07679152488708496,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15471102025645792,
      "grad_norm": 0.47231072187423706,
      "learning_rate": 8.305170564356542e-06,
      "loss": 0.1865,
      "mae_dtheta": 0.009675861336290836,
      "mae_dx": 0.002135857008397579,
      "mae_dy": 0.002862917259335518,
      "pose_mae_dtheta": 0.07328092306852341,
      "pose_mae_dx": 0.02411618083715439,
      "pose_mae_dy": 0.026134878396987915,
      "pose_rmse_dtheta": 0.2117835432291031,
      "pose_rmse_dx": 0.06163780018687248,
      "pose_rmse_dy": 0.05805053561925888,
      "pose_rmse_mean": 0.11049063503742218,
      "rmse_dtheta": 0.025044146925210953,
      "rmse_dx": 0.006162046454846859,
      "rmse_dy": 0.007100470829755068,
      "rmse_mean": 0.012768888846039772,
      "rotation_flip": 0.004795117769390345,
      "sparse_tokens": 32121.0,
      "step": 3330,
      "turn_loss": 0.07818485051393509,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1547574800223007,
      "grad_norm": 0.6134646534919739,
      "learning_rate": 8.304178313942536e-06,
      "loss": 0.1963,
      "mae_dtheta": 0.012814373709261417,
      "mae_dx": 0.0027716769836843014,
      "mae_dy": 0.0040437327697873116,
      "pose_mae_dtheta": 0.0873548611998558,
      "pose_mae_dx": 0.03257082402706146,
      "pose_mae_dy": 0.03577330335974693,
      "pose_rmse_dtheta": 0.20443840324878693,
      "pose_rmse_dx": 0.07786915451288223,
      "pose_rmse_dy": 0.07728423923254013,
      "pose_rmse_mean": 0.11986394226551056,
      "rmse_dtheta": 0.025992652401328087,
      "rmse_dx": 0.007581963203847408,
      "rmse_dy": 0.009365545585751534,
      "rmse_mean": 0.01431338768452406,
      "rotation_flip": 0.004022795706987381,
      "sparse_tokens": 32105.0,
      "step": 3331,
      "turn_loss": 0.1255141943693161,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.15480393978814347,
      "grad_norm": 0.5204978585243225,
      "learning_rate": 8.303185832465567e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.011735815554857254,
      "mae_dx": 0.00222588493488729,
      "mae_dy": 0.0033398715313524008,
      "pose_mae_dtheta": 0.07795287668704987,
      "pose_mae_dx": 0.03091355413198471,
      "pose_mae_dy": 0.03490392491221428,
      "pose_rmse_dtheta": 0.1719106137752533,
      "pose_rmse_dx": 0.07817226648330688,
      "pose_rmse_dy": 0.0801442340016365,
      "pose_rmse_mean": 0.1100757047533989,
      "rmse_dtheta": 0.023386038839817047,
      "rmse_dx": 0.005922072101384401,
      "rmse_dy": 0.007673096377402544,
      "rmse_mean": 0.012327069416642189,
      "rotation_flip": 0.007180650252848864,
      "sparse_tokens": 32057.0,
      "step": 3332,
      "turn_loss": 0.10692352056503296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.15485039955398625,
      "grad_norm": 0.5507181286811829,
      "learning_rate": 8.302193119995038e-06,
      "loss": 0.1214,
      "mae_dtheta": 0.020490137860178947,
      "mae_dx": 0.007526554632931948,
      "mae_dy": 0.004292211961001158,
      "pose_mae_dtheta": 0.14970232546329498,
      "pose_mae_dx": 0.05639081820845604,
      "pose_mae_dy": 0.06175537034869194,
      "pose_rmse_dtheta": 0.25436192750930786,
      "pose_rmse_dx": 0.13934117555618286,
      "pose_rmse_dy": 0.13767088949680328,
      "pose_rmse_mean": 0.17712466418743134,
      "rmse_dtheta": 0.03331274539232254,
      "rmse_dx": 0.017636990174651146,
      "rmse_dy": 0.008292707614600658,
      "rmse_mean": 0.019747482612729073,
      "rotation_flip": 0.007155634928494692,
      "sparse_tokens": 11971.0,
      "step": 3333,
      "turn_loss": 0.15114501118659973,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15489685931982902,
      "grad_norm": 0.37845146656036377,
      "learning_rate": 8.301200176600375e-06,
      "loss": 0.0938,
      "mae_dtheta": 0.008802860975265503,
      "mae_dx": 0.0011648443760350347,
      "mae_dy": 0.0008908853051252663,
      "pose_mae_dtheta": 0.06430737674236298,
      "pose_mae_dx": 0.011400156654417515,
      "pose_mae_dy": 0.0154326893389225,
      "pose_rmse_dtheta": 0.2224694788455963,
      "pose_rmse_dx": 0.02825385332107544,
      "pose_rmse_dy": 0.04126998409628868,
      "pose_rmse_mean": 0.09733110666275024,
      "rmse_dtheta": 0.027738254517316818,
      "rmse_dx": 0.003804021282121539,
      "rmse_dy": 0.0021035142708569765,
      "rmse_mean": 0.011215263977646828,
      "rotation_flip": 0.0019607844296842813,
      "sparse_tokens": 32089.0,
      "step": 3334,
      "turn_loss": 0.04277311637997627,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.1549433190856718,
      "grad_norm": 0.4174644351005554,
      "learning_rate": 8.30020700235101e-06,
      "loss": 0.1439,
      "mae_dtheta": 0.03339933231472969,
      "mae_dx": 0.010492678731679916,
      "mae_dy": 0.004558526910841465,
      "pose_mae_dtheta": 0.24452807009220123,
      "pose_mae_dx": 0.07935673743486404,
      "pose_mae_dy": 0.06536214053630829,
      "pose_rmse_dtheta": 0.47661828994750977,
      "pose_rmse_dx": 0.19276955723762512,
      "pose_rmse_dy": 0.12844260036945343,
      "pose_rmse_mean": 0.2659434676170349,
      "rmse_dtheta": 0.051213182508945465,
      "rmse_dx": 0.02403968758881092,
      "rmse_dy": 0.007738633081316948,
      "rmse_mean": 0.027663834393024445,
      "rotation_flip": 0.024122806265950203,
      "sparse_tokens": 8510.0,
      "step": 3335,
      "turn_loss": 0.24237105250358582,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.15498977885151458,
      "grad_norm": 0.7107511162757874,
      "learning_rate": 8.299213597316398e-06,
      "loss": 0.1446,
      "mae_dtheta": 0.01152971014380455,
      "mae_dx": 0.0019146422855556011,
      "mae_dy": 0.002886725589632988,
      "pose_mae_dtheta": 0.07844441384077072,
      "pose_mae_dx": 0.027791110798716545,
      "pose_mae_dy": 0.03236762806773186,
      "pose_rmse_dtheta": 0.18732504546642303,
      "pose_rmse_dx": 0.06923104077577591,
      "pose_rmse_dy": 0.07087564468383789,
      "pose_rmse_mean": 0.10914391279220581,
      "rmse_dtheta": 0.023624926805496216,
      "rmse_dx": 0.0050239781849086285,
      "rmse_dy": 0.005736391991376877,
      "rmse_mean": 0.011461766436696053,
      "rotation_flip": 0.005912494845688343,
      "sparse_tokens": 32073.0,
      "step": 3336,
      "turn_loss": 0.08868317306041718,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.15503623861735738,
      "grad_norm": 0.4729209542274475,
      "learning_rate": 8.298219961566008e-06,
      "loss": 0.1255,
      "mae_dtheta": 0.010778061114251614,
      "mae_dx": 0.0021608518436551094,
      "mae_dy": 0.002975618466734886,
      "pose_mae_dtheta": 0.07249757647514343,
      "pose_mae_dx": 0.02829856611788273,
      "pose_mae_dy": 0.03279434144496918,
      "pose_rmse_dtheta": 0.15713292360305786,
      "pose_rmse_dx": 0.08288994431495667,
      "pose_rmse_dy": 0.07168950140476227,
      "pose_rmse_mean": 0.103904128074646,
      "rmse_dtheta": 0.021414240822196007,
      "rmse_dx": 0.00688178651034832,
      "rmse_dy": 0.0071593960747122765,
      "rmse_mean": 0.01181847508996725,
      "rotation_flip": 0.006235385779291391,
      "sparse_tokens": 32073.0,
      "step": 3337,
      "turn_loss": 0.09920886904001236,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15508269838320016,
      "grad_norm": 0.41677701473236084,
      "learning_rate": 8.297226095169326e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.013482289388775826,
      "mae_dx": 0.001998841529712081,
      "mae_dy": 0.00316743110306561,
      "pose_mae_dtheta": 0.09419121593236923,
      "pose_mae_dx": 0.02758615091443062,
      "pose_mae_dy": 0.03214503824710846,
      "pose_rmse_dtheta": 0.2191227674484253,
      "pose_rmse_dx": 0.06342890858650208,
      "pose_rmse_dy": 0.07181401550769806,
      "pose_rmse_mean": 0.1181219071149826,
      "rmse_dtheta": 0.026463506743311882,
      "rmse_dx": 0.005127337295562029,
      "rmse_dy": 0.006855333223938942,
      "rmse_mean": 0.012815393507480621,
      "rotation_flip": 0.0060040028765797615,
      "sparse_tokens": 32121.0,
      "step": 3338,
      "turn_loss": 0.11372815072536469,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.15512915814904293,
      "grad_norm": 0.8100130558013916,
      "learning_rate": 8.296231998195853e-06,
      "loss": 0.2387,
      "mae_dtheta": 0.03835199400782585,
      "mae_dx": 0.013453928753733635,
      "mae_dy": 0.008102708496153355,
      "pose_mae_dtheta": 0.29849517345428467,
      "pose_mae_dx": 0.09595659375190735,
      "pose_mae_dy": 0.10019627958536148,
      "pose_rmse_dtheta": 0.5258820652961731,
      "pose_rmse_dx": 0.21296001970767975,
      "pose_rmse_dy": 0.2506251633167267,
      "pose_rmse_mean": 0.3298224210739136,
      "rmse_dtheta": 0.05769221857190132,
      "rmse_dx": 0.026673326268792152,
      "rmse_dy": 0.017308291047811508,
      "rmse_mean": 0.033891282975673676,
      "rotation_flip": 0.006487488280981779,
      "sparse_tokens": 18163.0,
      "step": 3339,
      "turn_loss": 0.37351933121681213,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1551756179148857,
      "grad_norm": 0.5177661776542664,
      "learning_rate": 8.295237670715109e-06,
      "loss": 0.1587,
      "mae_dtheta": 0.012620004825294018,
      "mae_dx": 0.0029401101637631655,
      "mae_dy": 0.0036336614284664392,
      "pose_mae_dtheta": 0.0897805243730545,
      "pose_mae_dx": 0.03233640268445015,
      "pose_mae_dy": 0.040555864572525024,
      "pose_rmse_dtheta": 0.18296338617801666,
      "pose_rmse_dx": 0.07608065009117126,
      "pose_rmse_dy": 0.09829047322273254,
      "pose_rmse_mean": 0.11911150813102722,
      "rmse_dtheta": 0.02342391200363636,
      "rmse_dx": 0.008042234927415848,
      "rmse_dy": 0.008072235621511936,
      "rmse_mean": 0.013179461471736431,
      "rotation_flip": 0.009711779654026031,
      "sparse_tokens": 32153.0,
      "step": 3340,
      "turn_loss": 0.10366696864366531,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1552220776807285,
      "grad_norm": 0.40018558502197266,
      "learning_rate": 8.294243112796625e-06,
      "loss": 0.103,
      "mae_dtheta": 0.011058960109949112,
      "mae_dx": 0.002191385254263878,
      "mae_dy": 0.0027006948366761208,
      "pose_mae_dtheta": 0.07740607857704163,
      "pose_mae_dx": 0.028698965907096863,
      "pose_mae_dy": 0.032176267355680466,
      "pose_rmse_dtheta": 0.1607753485441208,
      "pose_rmse_dx": 0.06938149034976959,
      "pose_rmse_dy": 0.07532769441604614,
      "pose_rmse_mean": 0.1018281802535057,
      "rmse_dtheta": 0.021418197080492973,
      "rmse_dx": 0.006847853306680918,
      "rmse_dy": 0.0063209072686731815,
      "rmse_mean": 0.011528986506164074,
      "rotation_flip": 0.005892255809158087,
      "sparse_tokens": 32073.0,
      "step": 3341,
      "turn_loss": 0.0942210927605629,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15526853744657126,
      "grad_norm": 0.4253416955471039,
      "learning_rate": 8.293248324509952e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.013672435656189919,
      "mae_dx": 0.0025807791389524937,
      "mae_dy": 0.002909418661147356,
      "pose_mae_dtheta": 0.09657730162143707,
      "pose_mae_dx": 0.025307422503829002,
      "pose_mae_dy": 0.035434164106845856,
      "pose_rmse_dtheta": 0.2508816421031952,
      "pose_rmse_dx": 0.07340016961097717,
      "pose_rmse_dy": 0.08632337301969528,
      "pose_rmse_mean": 0.1368684023618698,
      "rmse_dtheta": 0.029721464961767197,
      "rmse_dx": 0.007922147400677204,
      "rmse_dy": 0.007193036377429962,
      "rmse_mean": 0.01494554989039898,
      "rotation_flip": 0.006603384390473366,
      "sparse_tokens": 32121.0,
      "step": 3342,
      "turn_loss": 0.10855690389871597,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.15531499721241404,
      "grad_norm": 0.5047177672386169,
      "learning_rate": 8.292253305924656e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.028751367703080177,
      "mae_dx": 0.010115494020283222,
      "mae_dy": 0.007782327476888895,
      "pose_mae_dtheta": 0.19947592914104462,
      "pose_mae_dx": 0.10011995583772659,
      "pose_mae_dy": 0.09428579360246658,
      "pose_rmse_dtheta": 0.33125102519989014,
      "pose_rmse_dx": 0.19607630372047424,
      "pose_rmse_dy": 0.17504191398620605,
      "pose_rmse_mean": 0.2341230809688568,
      "rmse_dtheta": 0.04139946773648262,
      "rmse_dx": 0.021680425852537155,
      "rmse_dy": 0.013170624151825905,
      "rmse_mean": 0.025416839867830276,
      "rotation_flip": 0.014893617480993271,
      "sparse_tokens": 16801.0,
      "step": 3343,
      "turn_loss": 0.27951914072036743,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15536145697825682,
      "grad_norm": 0.48655810952186584,
      "learning_rate": 8.29125805711032e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.008781416341662407,
      "mae_dx": 0.0014220888260751963,
      "mae_dy": 0.0017073750495910645,
      "pose_mae_dtheta": 0.05859683081507683,
      "pose_mae_dx": 0.015962306410074234,
      "pose_mae_dy": 0.023723170161247253,
      "pose_rmse_dtheta": 0.15044312179088593,
      "pose_rmse_dx": 0.037656623870134354,
      "pose_rmse_dy": 0.0590224526822567,
      "pose_rmse_mean": 0.08237406611442566,
      "rmse_dtheta": 0.01958415098488331,
      "rmse_dx": 0.004257738124579191,
      "rmse_dy": 0.004042220767587423,
      "rmse_mean": 0.009294703602790833,
      "rotation_flip": 0.002533783670514822,
      "sparse_tokens": 32105.0,
      "step": 3344,
      "turn_loss": 0.07642246782779694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15540791674409962,
      "grad_norm": 0.3985828161239624,
      "learning_rate": 8.290262578136541e-06,
      "loss": 0.068,
      "mae_dtheta": 0.010687777772545815,
      "mae_dx": 0.0016540958313271403,
      "mae_dy": 0.0022903303615748882,
      "pose_mae_dtheta": 0.07331725209951401,
      "pose_mae_dx": 0.02338533103466034,
      "pose_mae_dy": 0.03187935799360275,
      "pose_rmse_dtheta": 0.18702229857444763,
      "pose_rmse_dx": 0.06315750628709793,
      "pose_rmse_dy": 0.08073209226131439,
      "pose_rmse_mean": 0.11030396074056625,
      "rmse_dtheta": 0.02333143725991249,
      "rmse_dx": 0.005717532243579626,
      "rmse_dy": 0.005202403292059898,
      "rmse_mean": 0.011417124420404434,
      "rotation_flip": 0.0027777778450399637,
      "sparse_tokens": 32089.0,
      "step": 3345,
      "turn_loss": 0.0913221687078476,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1554543765099424,
      "grad_norm": 0.4015684723854065,
      "learning_rate": 8.289266869072933e-06,
      "loss": 0.113,
      "mae_dtheta": 0.010674103163182735,
      "mae_dx": 0.0022302456200122833,
      "mae_dy": 0.0030970473308116198,
      "pose_mae_dtheta": 0.06516872346401215,
      "pose_mae_dx": 0.027643490582704544,
      "pose_mae_dy": 0.03086499124765396,
      "pose_rmse_dtheta": 0.14754675328731537,
      "pose_rmse_dx": 0.07459259033203125,
      "pose_rmse_dy": 0.07788202911615372,
      "pose_rmse_mean": 0.10000713169574738,
      "rmse_dtheta": 0.022502796724438667,
      "rmse_dx": 0.007182530127465725,
      "rmse_dy": 0.008470786735415459,
      "rmse_mean": 0.012718705460429192,
      "rotation_flip": 0.007550018839538097,
      "sparse_tokens": 32121.0,
      "step": 3346,
      "turn_loss": 0.1058625876903534,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15550083627578518,
      "grad_norm": 0.5472568869590759,
      "learning_rate": 8.288270929989128e-06,
      "loss": 0.1241,
      "mae_dtheta": 0.0082982974126935,
      "mae_dx": 0.0020399847999215126,
      "mae_dy": 0.00241684727370739,
      "pose_mae_dtheta": 0.05535474419593811,
      "pose_mae_dx": 0.02508045732975006,
      "pose_mae_dy": 0.025973157957196236,
      "pose_rmse_dtheta": 0.11839628964662552,
      "pose_rmse_dx": 0.06857849657535553,
      "pose_rmse_dy": 0.05446762964129448,
      "pose_rmse_mean": 0.08048081398010254,
      "rmse_dtheta": 0.017204059287905693,
      "rmse_dx": 0.005484660156071186,
      "rmse_dy": 0.005414429120719433,
      "rmse_mean": 0.009367717429995537,
      "rotation_flip": 0.004201680887490511,
      "sparse_tokens": 32121.0,
      "step": 3347,
      "turn_loss": 0.07846831530332565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15554729604162795,
      "grad_norm": 0.6213634014129639,
      "learning_rate": 8.287274760954774e-06,
      "loss": 0.2019,
      "mae_dtheta": 0.014644937589764595,
      "mae_dx": 0.00340771465562284,
      "mae_dy": 0.004751704633235931,
      "pose_mae_dtheta": 0.1047462597489357,
      "pose_mae_dx": 0.042191650718450546,
      "pose_mae_dy": 0.04808272421360016,
      "pose_rmse_dtheta": 0.2173989713191986,
      "pose_rmse_dx": 0.10604572296142578,
      "pose_rmse_dy": 0.11176285892724991,
      "pose_rmse_mean": 0.1450691819190979,
      "rmse_dtheta": 0.02755296230316162,
      "rmse_dx": 0.00946806650608778,
      "rmse_dy": 0.010797424241900444,
      "rmse_mean": 0.015939485281705856,
      "rotation_flip": 0.009057363495230675,
      "sparse_tokens": 32105.0,
      "step": 3348,
      "turn_loss": 0.13880836963653564,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.15559375580747073,
      "grad_norm": 0.31802499294281006,
      "learning_rate": 8.286278362039527e-06,
      "loss": 0.1004,
      "mae_dtheta": 0.010044138878583908,
      "mae_dx": 0.0012494002003222704,
      "mae_dy": 0.0013254581717774272,
      "pose_mae_dtheta": 0.06847207248210907,
      "pose_mae_dx": 0.014852598309516907,
      "pose_mae_dy": 0.020435580983757973,
      "pose_rmse_dtheta": 0.20160768926143646,
      "pose_rmse_dx": 0.034656088799238205,
      "pose_rmse_dy": 0.05284154787659645,
      "pose_rmse_mean": 0.0963684469461441,
      "rmse_dtheta": 0.024608267471194267,
      "rmse_dx": 0.0035573949571698904,
      "rmse_dy": 0.00291886692866683,
      "rmse_mean": 0.010361510328948498,
      "rotation_flip": 0.0046278443187475204,
      "sparse_tokens": 32153.0,
      "step": 3349,
      "turn_loss": 0.06054529547691345,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1556402155733135,
      "grad_norm": 0.48817792534828186,
      "learning_rate": 8.285281733313073e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.01158697810024023,
      "mae_dx": 0.002218488836660981,
      "mae_dy": 0.00272919237613678,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4881778955459595,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.44119262695312,
      "model/head/act_norm_mean": 110.28365688131314,
      "model/head/act_norm_min": 63.80120086669922,
      "model/head/act_over_embed": 75.78796150070129,
      "model/head/grad_frac": 0.10601060092449188,
      "model/head/grad_norm": 0.05175203084945679,
      "model/head/grad_zero_frac": 0.0001725958427414298,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6925899621212122,
      "model/head/update_ratio": 0.0008917634258978069,
      "model/head/weight_delta": 6.802399158477783,
      "model/head/weight_delta_rel": 0.11933422833681107,
      "model/head/weight_norm": 58.033363342285156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4167378842830658,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4166753827737817,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4166087508201599,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2863432240185372,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06970629096031189,
      "model/modality_embedder.encoders.pose/grad_norm": 0.034029070287942886,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5290387527533039,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011034072376787663,
      "model/modality_embedder.encoders.pose/weight_delta": 2.2335996627807617,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0729786604642868,
      "model/modality_embedder.encoders.pose/weight_norm": 30.83999252319336,
      "model/modality_embedder/grad_frac": 0.06970629096031189,
      "model/modality_embedder/grad_norm": 0.034029070287942886,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5290387527533039,
      "model/modality_embedder/update_ratio": 0.0011034072376787663,
      "model/modality_embedder/weight_delta": 2.2335996627807617,
      "model/modality_embedder/weight_delta_rel": 0.0729786604642868,
      "model/modality_embedder/weight_norm": 30.83999252319336,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.8242416381836,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.5506578683662,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.953392028808594,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.18423257187401,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.081234872341156,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03965706750750542,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014314008876681328,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.5287052392959595,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0557069405913353,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.705074310302734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.162353515625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.586439794773128,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.277009010314941,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.896031608844027,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0867483839392662,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04234864190220833,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014433098258450627,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.9287605285644531,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06681377440690994,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.341339111328125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.1043701171875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.503291847041847,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.571866989135742,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.213310285014746,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0920744389295578,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04494870454072952,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014840469229966402,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.067903518676758,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.06943632662296295,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.287925720214844,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.68445587158203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.33344105739939,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.153118133544922,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.471005956499308,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1126779094338417,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05500686541199684,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018568168161436915,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.7654781341552734,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0603356659412384,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.624282836914062,
      "model/normalizer/grad_frac": 0.43156197667121887,
      "model/normalizer/grad_norm": 0.21067902445793152,
      "model/normalizer/grad_zero_frac": 0.00016426164074800909,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002694895025342703,
      "model/normalizer/weight_delta": 3.7537941932678223,
      "model/normalizer/weight_delta_rel": 0.04834669455885887,
      "model/normalizer/weight_norm": 78.17707824707031,
      "pose_mae_dtheta": 0.07693077623844147,
      "pose_mae_dx": 0.02931598201394081,
      "pose_mae_dy": 0.02918710932135582,
      "pose_rmse_dtheta": 0.18188433349132538,
      "pose_rmse_dx": 0.07696884125471115,
      "pose_rmse_dy": 0.08235402405261993,
      "pose_rmse_mean": 0.11373573541641235,
      "rmse_dtheta": 0.024645427241921425,
      "rmse_dx": 0.0059674447402358055,
      "rmse_dy": 0.006701097823679447,
      "rmse_mean": 0.012437989935278893,
      "rotation_flip": 0.0028368793427944183,
      "sparse_tokens": 32137.0,
      "step": 3350,
      "turn_loss": 0.1055264100432396,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.15568667533915628,
      "grad_norm": 0.7263964414596558,
      "learning_rate": 8.284284874845104e-06,
      "loss": 0.1248,
      "mae_dtheta": 0.009667565114796162,
      "mae_dx": 0.0019650112371891737,
      "mae_dy": 0.0015210092533379793,
      "pose_mae_dtheta": 0.0712900385260582,
      "pose_mae_dx": 0.019780578091740608,
      "pose_mae_dy": 0.02113562822341919,
      "pose_rmse_dtheta": 0.20429107546806335,
      "pose_rmse_dx": 0.054819438606500626,
      "pose_rmse_dy": 0.05405532196164131,
      "pose_rmse_mean": 0.10438861697912216,
      "rmse_dtheta": 0.024916933849453926,
      "rmse_dx": 0.006750360131263733,
      "rmse_dy": 0.003414514474570751,
      "rmse_mean": 0.011693935841321945,
      "rotation_flip": 0.003546099178493023,
      "sparse_tokens": 32153.0,
      "step": 3351,
      "turn_loss": 0.08431566506624222,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.15573313510499906,
      "grad_norm": 0.535953938961029,
      "learning_rate": 8.283287786705331e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.03179933503270149,
      "mae_dx": 0.010964874178171158,
      "mae_dy": 0.007209850009530783,
      "pose_mae_dtheta": 0.25420138239860535,
      "pose_mae_dx": 0.0894027128815651,
      "pose_mae_dy": 0.09094817191362381,
      "pose_rmse_dtheta": 0.4316723942756653,
      "pose_rmse_dx": 0.17853470146656036,
      "pose_rmse_dy": 0.17663489282131195,
      "pose_rmse_mean": 0.26228067278862,
      "rmse_dtheta": 0.04788791388273239,
      "rmse_dx": 0.02171403169631958,
      "rmse_dy": 0.01123724039644003,
      "rmse_mean": 0.02694639563560486,
      "rotation_flip": 0.01262626238167286,
      "sparse_tokens": 6349.0,
      "step": 3352,
      "turn_loss": 0.26545265316963196,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15577959487084186,
      "grad_norm": 0.421462744474411,
      "learning_rate": 8.28229046896348e-06,
      "loss": 0.138,
      "mae_dtheta": 0.010159820318222046,
      "mae_dx": 0.0015203108778223395,
      "mae_dy": 0.0017497240332886577,
      "pose_mae_dtheta": 0.06859194487333298,
      "pose_mae_dx": 0.017122551798820496,
      "pose_mae_dy": 0.02249922975897789,
      "pose_rmse_dtheta": 0.1975487917661667,
      "pose_rmse_dx": 0.041860293596982956,
      "pose_rmse_dy": 0.051796913146972656,
      "pose_rmse_mean": 0.0970686674118042,
      "rmse_dtheta": 0.024700233712792397,
      "rmse_dx": 0.004620907828211784,
      "rmse_dy": 0.00406589126214385,
      "rmse_mean": 0.01112901046872139,
      "rotation_flip": 0.005063291173428297,
      "sparse_tokens": 32089.0,
      "step": 3353,
      "turn_loss": 0.07041613757610321,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.15582605463668464,
      "grad_norm": 0.374459445476532,
      "learning_rate": 8.281292921689297e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.00849589891731739,
      "mae_dx": 0.0018648375989869237,
      "mae_dy": 0.0012497507268562913,
      "pose_mae_dtheta": 0.0630544051527977,
      "pose_mae_dx": 0.019765976816415787,
      "pose_mae_dy": 0.01622721739113331,
      "pose_rmse_dtheta": 0.198641836643219,
      "pose_rmse_dx": 0.04691756144165993,
      "pose_rmse_dy": 0.05106916278600693,
      "pose_rmse_mean": 0.09887619316577911,
      "rmse_dtheta": 0.023758793249726295,
      "rmse_dx": 0.005154648330062628,
      "rmse_dy": 0.0031998357735574245,
      "rmse_mean": 0.01070442609488964,
      "rotation_flip": 0.0053114439360797405,
      "sparse_tokens": 32185.0,
      "step": 3354,
      "turn_loss": 0.057076483964920044,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.15587251440252742,
      "grad_norm": 0.5771915316581726,
      "learning_rate": 8.280295144952537e-06,
      "loss": 0.2019,
      "mae_dtheta": 0.029430853202939034,
      "mae_dx": 0.010865792632102966,
      "mae_dy": 0.0026234183460474014,
      "pose_mae_dtheta": 0.23679077625274658,
      "pose_mae_dx": 0.07766680419445038,
      "pose_mae_dy": 0.03439490497112274,
      "pose_rmse_dtheta": 0.44577306509017944,
      "pose_rmse_dx": 0.1679140031337738,
      "pose_rmse_dy": 0.09192320704460144,
      "pose_rmse_mean": 0.23520343005657196,
      "rmse_dtheta": 0.04803977534174919,
      "rmse_dx": 0.02200334519147873,
      "rmse_dy": 0.005509581882506609,
      "rmse_mean": 0.025184234604239464,
      "rotation_flip": 0.01154734380543232,
      "sparse_tokens": 7567.0,
      "step": 3355,
      "turn_loss": 0.16674457490444183,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.1559189741683702,
      "grad_norm": 0.5485315322875977,
      "learning_rate": 8.279297138822976e-06,
      "loss": 0.1611,
      "mae_dtheta": 0.040602829307317734,
      "mae_dx": 0.012668690644204617,
      "mae_dy": 0.010281560942530632,
      "pose_mae_dtheta": 0.32183778285980225,
      "pose_mae_dx": 0.10633095353841782,
      "pose_mae_dy": 0.13883347809314728,
      "pose_rmse_dtheta": 0.5361286997795105,
      "pose_rmse_dx": 0.22141271829605103,
      "pose_rmse_dy": 0.28143173456192017,
      "pose_rmse_mean": 0.3463243842124939,
      "rmse_dtheta": 0.05735645815730095,
      "rmse_dx": 0.024845225736498833,
      "rmse_dy": 0.0187677089124918,
      "rmse_mean": 0.03365646302700043,
      "rotation_flip": 0.015384615398943424,
      "sparse_tokens": 14219.0,
      "step": 3356,
      "turn_loss": 0.4043806195259094,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.15596543393421297,
      "grad_norm": 0.6783369183540344,
      "learning_rate": 8.278298903370407e-06,
      "loss": 0.1983,
      "mae_dtheta": 0.008426908403635025,
      "mae_dx": 0.003568128449842334,
      "mae_dy": 0.0011089317267760634,
      "pose_mae_dtheta": 0.05983962491154671,
      "pose_mae_dx": 0.031045952811837196,
      "pose_mae_dy": 0.012475579977035522,
      "pose_rmse_dtheta": 0.22115746140480042,
      "pose_rmse_dx": 0.07054711133241653,
      "pose_rmse_dy": 0.04399961978197098,
      "pose_rmse_mean": 0.11190139502286911,
      "rmse_dtheta": 0.027093051001429558,
      "rmse_dx": 0.009956021793186665,
      "rmse_dy": 0.005442355759441853,
      "rmse_mean": 0.014163809828460217,
      "rotation_flip": 0.0033632286358624697,
      "sparse_tokens": 32185.0,
      "step": 3357,
      "turn_loss": 0.11775527149438858,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.15601189370005575,
      "grad_norm": 0.440046489238739,
      "learning_rate": 8.277300438664638e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.025661345571279526,
      "mae_dx": 0.006893829442560673,
      "mae_dy": 0.002396075753495097,
      "pose_mae_dtheta": 0.20370230078697205,
      "pose_mae_dx": 0.05234333872795105,
      "pose_mae_dy": 0.02110828459262848,
      "pose_rmse_dtheta": 0.357204794883728,
      "pose_rmse_dx": 0.1391793191432953,
      "pose_rmse_dy": 0.04281741380691528,
      "pose_rmse_mean": 0.17973384261131287,
      "rmse_dtheta": 0.04114531725645065,
      "rmse_dx": 0.0165516659617424,
      "rmse_dy": 0.005169701762497425,
      "rmse_mean": 0.020955562591552734,
      "rotation_flip": 0.014880952425301075,
      "sparse_tokens": 5701.0,
      "step": 3358,
      "turn_loss": 0.21164199709892273,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 36226.0,
      "epoch": 0.15605835346589852,
      "grad_norm": 0.44895416498184204,
      "learning_rate": 8.276301744775488e-06,
      "loss": 0.153,
      "mae_dtheta": 0.03896113112568855,
      "mae_dx": 0.014240305870771408,
      "mae_dy": 0.004805810283869505,
      "pose_mae_dtheta": 0.3141455352306366,
      "pose_mae_dx": 0.12294068932533264,
      "pose_mae_dy": 0.05425400286912918,
      "pose_rmse_dtheta": 0.5241574645042419,
      "pose_rmse_dx": 0.24090667068958282,
      "pose_rmse_dy": 0.11879386007785797,
      "pose_rmse_mean": 0.2946193218231201,
      "rmse_dtheta": 0.055911120027303696,
      "rmse_dx": 0.026204053312540054,
      "rmse_dy": 0.009748774580657482,
      "rmse_mean": 0.03062131628394127,
      "rotation_flip": 0.0175029169768095,
      "sparse_tokens": 27584.0,
      "step": 3359,
      "turn_loss": 0.3093300461769104,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1561048132317413,
      "grad_norm": 0.571238100528717,
      "learning_rate": 8.275302821772799e-06,
      "loss": 0.125,
      "mae_dtheta": 0.013788184151053429,
      "mae_dx": 0.0021738368086516857,
      "mae_dy": 0.001330524100922048,
      "pose_mae_dtheta": 0.10205017030239105,
      "pose_mae_dx": 0.021960962563753128,
      "pose_mae_dy": 0.02378019690513611,
      "pose_rmse_dtheta": 0.2678765058517456,
      "pose_rmse_dx": 0.04913880676031113,
      "pose_rmse_dy": 0.06350527703762054,
      "pose_rmse_mean": 0.12684020400047302,
      "rmse_dtheta": 0.03213793784379959,
      "rmse_dx": 0.006403889041393995,
      "rmse_dy": 0.0029780836775898933,
      "rmse_mean": 0.013839970342814922,
      "rotation_flip": 0.0009041591547429562,
      "sparse_tokens": 32169.0,
      "step": 3360,
      "turn_loss": 0.10066088289022446,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.15615127299758408,
      "grad_norm": 0.43028533458709717,
      "learning_rate": 8.274303669726427e-06,
      "loss": 0.0956,
      "mae_dtheta": 0.03820366784930229,
      "mae_dx": 0.01697789691388607,
      "mae_dy": 0.007399559952318668,
      "pose_mae_dtheta": 0.2821003198623657,
      "pose_mae_dx": 0.12716630101203918,
      "pose_mae_dy": 0.09700765460729599,
      "pose_rmse_dtheta": 0.4479207694530487,
      "pose_rmse_dx": 0.24924276769161224,
      "pose_rmse_dy": 0.1980230063199997,
      "pose_rmse_mean": 0.2983955144882202,
      "rmse_dtheta": 0.05345726013183594,
      "rmse_dx": 0.030348900705575943,
      "rmse_dy": 0.012053984217345715,
      "rmse_mean": 0.03195337951183319,
      "rotation_flip": 0.0139860138297081,
      "sparse_tokens": 11567.0,
      "step": 3361,
      "turn_loss": 0.3391737639904022,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.15619773276342688,
      "grad_norm": 0.5145711898803711,
      "learning_rate": 8.27330428870624e-06,
      "loss": 0.1434,
      "mae_dtheta": 0.007665563374757767,
      "mae_dx": 0.003365406533703208,
      "mae_dy": 0.0018158209277316928,
      "pose_mae_dtheta": 0.0504644438624382,
      "pose_mae_dx": 0.03085797280073166,
      "pose_mae_dy": 0.019333798438310623,
      "pose_rmse_dtheta": 0.11116477102041245,
      "pose_rmse_dx": 0.10164577513933182,
      "pose_rmse_dy": 0.047555625438690186,
      "pose_rmse_mean": 0.08678872883319855,
      "rmse_dtheta": 0.01792157255113125,
      "rmse_dx": 0.01100253127515316,
      "rmse_dy": 0.004587029572576284,
      "rmse_mean": 0.01117037795484066,
      "rotation_flip": 0.007206208538264036,
      "sparse_tokens": 32057.0,
      "step": 3362,
      "turn_loss": 0.09518513828516006,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.15624419252926966,
      "grad_norm": 0.5438529849052429,
      "learning_rate": 8.272304678782129e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.010341918095946312,
      "mae_dx": 0.0034589096903800964,
      "mae_dy": 0.0022288323380053043,
      "pose_mae_dtheta": 0.07520511746406555,
      "pose_mae_dx": 0.036100976169109344,
      "pose_mae_dy": 0.029490385204553604,
      "pose_rmse_dtheta": 0.1921592652797699,
      "pose_rmse_dx": 0.10930821299552917,
      "pose_rmse_dy": 0.07327496260404587,
      "pose_rmse_mean": 0.12491415441036224,
      "rmse_dtheta": 0.023385193198919296,
      "rmse_dx": 0.011293723247945309,
      "rmse_dy": 0.00543573871254921,
      "rmse_mean": 0.013371552340686321,
      "rotation_flip": 0.005090497899800539,
      "sparse_tokens": 32041.0,
      "step": 3363,
      "turn_loss": 0.08553481847047806,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.15629065229511244,
      "grad_norm": 0.6010234355926514,
      "learning_rate": 8.271304840023993e-06,
      "loss": 0.1587,
      "mae_dtheta": 0.0224101934581995,
      "mae_dx": 0.010309652425348759,
      "mae_dy": 0.006264959461987019,
      "pose_mae_dtheta": 0.17581723630428314,
      "pose_mae_dx": 0.09035973250865936,
      "pose_mae_dy": 0.07746033370494843,
      "pose_rmse_dtheta": 0.30923423171043396,
      "pose_rmse_dx": 0.21746473014354706,
      "pose_rmse_dy": 0.16481426358222961,
      "pose_rmse_mean": 0.23050439357757568,
      "rmse_dtheta": 0.03567890077829361,
      "rmse_dx": 0.023651013150811195,
      "rmse_dy": 0.011190203949809074,
      "rmse_mean": 0.023506706580519676,
      "rotation_flip": 0.01056338008493185,
      "sparse_tokens": 12597.0,
      "step": 3364,
      "turn_loss": 0.19939878582954407,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1563371120609552,
      "grad_norm": 0.38820067048072815,
      "learning_rate": 8.270304772501756e-06,
      "loss": 0.1272,
      "mae_dtheta": 0.011020726524293423,
      "mae_dx": 0.0016594893531873822,
      "mae_dy": 0.0021171891130506992,
      "pose_mae_dtheta": 0.06841100007295609,
      "pose_mae_dx": 0.020756863057613373,
      "pose_mae_dy": 0.029023654758930206,
      "pose_rmse_dtheta": 0.1658300757408142,
      "pose_rmse_dx": 0.06105620041489601,
      "pose_rmse_dy": 0.0663895383477211,
      "pose_rmse_mean": 0.09775860607624054,
      "rmse_dtheta": 0.02396129071712494,
      "rmse_dx": 0.0046759662218391895,
      "rmse_dy": 0.004829243756830692,
      "rmse_mean": 0.011155500076711178,
      "rotation_flip": 0.008378870785236359,
      "sparse_tokens": 32121.0,
      "step": 3365,
      "turn_loss": 0.09262970089912415,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.156383571826798,
      "grad_norm": 0.561424732208252,
      "learning_rate": 8.269304476285349e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.037282079458236694,
      "mae_dx": 0.009799470193684101,
      "mae_dy": 0.004732860717922449,
      "pose_mae_dtheta": 0.26620370149612427,
      "pose_mae_dx": 0.07900571078062057,
      "pose_mae_dy": 0.0490705743432045,
      "pose_rmse_dtheta": 0.4590335190296173,
      "pose_rmse_dx": 0.1520669162273407,
      "pose_rmse_dy": 0.1179719939827919,
      "pose_rmse_mean": 0.24302415549755096,
      "rmse_dtheta": 0.056113481521606445,
      "rmse_dx": 0.01950015500187874,
      "rmse_dy": 0.009550920687615871,
      "rmse_mean": 0.028388185426592827,
      "rotation_flip": 0.017331022769212723,
      "sparse_tokens": 9571.0,
      "step": 3366,
      "turn_loss": 0.21105942130088806,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.15643003159264077,
      "grad_norm": 0.7651666402816772,
      "learning_rate": 8.268303951444727e-06,
      "loss": 0.1754,
      "mae_dtheta": 0.022346006706357002,
      "mae_dx": 0.0073813400231301785,
      "mae_dy": 0.003652778221294284,
      "pose_mae_dtheta": 0.17352913320064545,
      "pose_mae_dx": 0.06638619303703308,
      "pose_mae_dy": 0.057934749871492386,
      "pose_rmse_dtheta": 0.3671439290046692,
      "pose_rmse_dx": 0.19291388988494873,
      "pose_rmse_dy": 0.12046180665493011,
      "pose_rmse_mean": 0.22683988511562347,
      "rmse_dtheta": 0.040768858045339584,
      "rmse_dx": 0.020236726850271225,
      "rmse_dy": 0.006512410007417202,
      "rmse_mean": 0.022505998611450195,
      "rotation_flip": 0.00691244238987565,
      "sparse_tokens": 12255.0,
      "step": 3367,
      "turn_loss": 0.11007405072450638,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.15647649135848354,
      "grad_norm": 0.47064486145973206,
      "learning_rate": 8.267303198049853e-06,
      "loss": 0.1368,
      "mae_dtheta": 0.011062956415116787,
      "mae_dx": 0.0013199166860431433,
      "mae_dy": 0.0020753268618136644,
      "pose_mae_dtheta": 0.07064418494701385,
      "pose_mae_dx": 0.022534416988492012,
      "pose_mae_dy": 0.02975780889391899,
      "pose_rmse_dtheta": 0.15904009342193604,
      "pose_rmse_dx": 0.05413700267672539,
      "pose_rmse_dy": 0.061929747462272644,
      "pose_rmse_mean": 0.09170228242874146,
      "rmse_dtheta": 0.02248310297727585,
      "rmse_dx": 0.0039603631012141705,
      "rmse_dy": 0.0038932557217776775,
      "rmse_mean": 0.01011224091053009,
      "rotation_flip": 0.00298062595538795,
      "sparse_tokens": 32073.0,
      "step": 3368,
      "turn_loss": 0.0838165283203125,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.15652295112432632,
      "grad_norm": 0.4284495413303375,
      "learning_rate": 8.266302216170716e-06,
      "loss": 0.0922,
      "mae_dtheta": 0.015919800847768784,
      "mae_dx": 0.0022825379855930805,
      "mae_dy": 0.0033536877017468214,
      "pose_mae_dtheta": 0.10837681591510773,
      "pose_mae_dx": 0.029839150607585907,
      "pose_mae_dy": 0.05344279482960701,
      "pose_rmse_dtheta": 0.20861060917377472,
      "pose_rmse_dx": 0.07455605268478394,
      "pose_rmse_dy": 0.10834164172410965,
      "pose_rmse_mean": 0.13050276041030884,
      "rmse_dtheta": 0.029584914445877075,
      "rmse_dx": 0.009446444921195507,
      "rmse_dy": 0.005663248710334301,
      "rmse_mean": 0.014898203313350677,
      "rotation_flip": 0.006637168116867542,
      "sparse_tokens": 10511.0,
      "step": 3369,
      "turn_loss": 0.12380639463663101,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.15656941089016913,
      "grad_norm": 0.5608017444610596,
      "learning_rate": 8.26530100587731e-06,
      "loss": 0.1308,
      "mae_dtheta": 0.00945338886231184,
      "mae_dx": 0.0016948811244219542,
      "mae_dy": 0.002541810506954789,
      "pose_mae_dtheta": 0.06283614039421082,
      "pose_mae_dx": 0.023660952225327492,
      "pose_mae_dy": 0.02957862615585327,
      "pose_rmse_dtheta": 0.14965099096298218,
      "pose_rmse_dx": 0.06228657066822052,
      "pose_rmse_dy": 0.0786079615354538,
      "pose_rmse_mean": 0.0968485102057457,
      "rmse_dtheta": 0.020636731758713722,
      "rmse_dx": 0.004839086905121803,
      "rmse_dy": 0.005915903020650148,
      "rmse_mean": 0.01046390738338232,
      "rotation_flip": 0.0020811655558645725,
      "sparse_tokens": 32073.0,
      "step": 3370,
      "turn_loss": 0.0833631381392479,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.1566158706560119,
      "grad_norm": 0.6176762580871582,
      "learning_rate": 8.264299567239652e-06,
      "loss": 0.1353,
      "mae_dtheta": 0.037623386830091476,
      "mae_dx": 0.016165174543857574,
      "mae_dy": 0.0035464835818856955,
      "pose_mae_dtheta": 0.2945018708705902,
      "pose_mae_dx": 0.135464146733284,
      "pose_mae_dy": 0.04612129181623459,
      "pose_rmse_dtheta": 0.49360391497612,
      "pose_rmse_dx": 0.2786805331707001,
      "pose_rmse_dy": 0.10743831843137741,
      "pose_rmse_mean": 0.2932409346103668,
      "rmse_dtheta": 0.05399327352643013,
      "rmse_dx": 0.02990436926484108,
      "rmse_dy": 0.006774044595658779,
      "rmse_mean": 0.030223896726965904,
      "rotation_flip": 0.008221994154155254,
      "sparse_tokens": 17729.0,
      "step": 3371,
      "turn_loss": 0.3148515522480011,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15666233042185468,
      "grad_norm": 0.4255675673484802,
      "learning_rate": 8.263297900327774e-06,
      "loss": 0.0868,
      "mae_dtheta": 0.011741550639271736,
      "mae_dx": 0.0020176307298243046,
      "mae_dy": 0.0026715535204857588,
      "pose_mae_dtheta": 0.0740903839468956,
      "pose_mae_dx": 0.026377571746706963,
      "pose_mae_dy": 0.029663389548659325,
      "pose_rmse_dtheta": 0.15107861161231995,
      "pose_rmse_dx": 0.06022510305047035,
      "pose_rmse_dy": 0.06325208395719528,
      "pose_rmse_mean": 0.09151860326528549,
      "rmse_dtheta": 0.021147267892956734,
      "rmse_dx": 0.00555273424834013,
      "rmse_dy": 0.005447296891361475,
      "rmse_mean": 0.010715766809880733,
      "rotation_flip": 0.0,
      "sparse_tokens": 32089.0,
      "step": 3372,
      "turn_loss": 0.0936267077922821,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.15670879018769746,
      "grad_norm": 0.5413586497306824,
      "learning_rate": 8.262296005211722e-06,
      "loss": 0.1425,
      "mae_dtheta": 0.03618127852678299,
      "mae_dx": 0.013950491324067116,
      "mae_dy": 0.00845197681337595,
      "pose_mae_dtheta": 0.30533185601234436,
      "pose_mae_dx": 0.10975158214569092,
      "pose_mae_dy": 0.07636424154043198,
      "pose_rmse_dtheta": 0.5101669430732727,
      "pose_rmse_dx": 0.22507654130458832,
      "pose_rmse_dy": 0.16872544586658478,
      "pose_rmse_mean": 0.3013229966163635,
      "rmse_dtheta": 0.05387010797858238,
      "rmse_dx": 0.02674245648086071,
      "rmse_dy": 0.01746560074388981,
      "rmse_mean": 0.03269272297620773,
      "rotation_flip": 0.020202020183205605,
      "sparse_tokens": 17641.0,
      "step": 3373,
      "turn_loss": 0.3519611060619354,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15675524995354023,
      "grad_norm": 0.4475955069065094,
      "learning_rate": 8.26129388196156e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.010720749385654926,
      "mae_dx": 0.0017262751935049891,
      "mae_dy": 0.002269878750666976,
      "pose_mae_dtheta": 0.076250359416008,
      "pose_mae_dx": 0.02485065534710884,
      "pose_mae_dy": 0.029577825218439102,
      "pose_rmse_dtheta": 0.2054719477891922,
      "pose_rmse_dx": 0.06203112006187439,
      "pose_rmse_dy": 0.06511107832193375,
      "pose_rmse_mean": 0.11087138950824738,
      "rmse_dtheta": 0.023966437205672264,
      "rmse_dx": 0.005257810465991497,
      "rmse_dy": 0.004757299553602934,
      "rmse_mean": 0.011327182874083519,
      "rotation_flip": 0.003443822730332613,
      "sparse_tokens": 32089.0,
      "step": 3374,
      "turn_loss": 0.07910331338644028,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.156801709719383,
      "grad_norm": 0.6240019798278809,
      "learning_rate": 8.260291530647364e-06,
      "loss": 0.1439,
      "mae_dtheta": 0.0390007346868515,
      "mae_dx": 0.011648787185549736,
      "mae_dy": 0.006557436194270849,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6240018606185913,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 134.56201171875,
      "model/head/act_norm_mean": 106.49590674867021,
      "model/head/act_norm_min": 63.59553527832031,
      "model/head/act_over_embed": 73.18498414807362,
      "model/head/grad_frac": 0.10383933037519455,
      "model/head/grad_norm": 0.06479593366384506,
      "model/head/grad_zero_frac": 0.00017227856733370572,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6883934507978723,
      "model/head/update_ratio": 0.0011164241004735231,
      "model/head/weight_delta": 6.82988166809082,
      "model/head/weight_delta_rel": 0.119816355407238,
      "model/head/weight_norm": 58.038814544677734,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41661712527275085,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41661712527275085,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41661712527275085,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2863031889184135,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1116260215640068,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06965484470129013,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0022584693506360054,
      "model/modality_embedder.encoders.pose/weight_delta": 2.2434070110321045,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0732991024851799,
      "model/modality_embedder.encoders.pose/weight_norm": 30.841615676879883,
      "model/modality_embedder/grad_frac": 0.1116260215640068,
      "model/modality_embedder/grad_norm": 0.06965484470129013,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0022584693506360054,
      "model/modality_embedder/weight_delta": 2.2434070110321045,
      "model/modality_embedder/weight_delta_rel": 0.0732991024851799,
      "model/modality_embedder/weight_norm": 30.841615676879883,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.84444427490234,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.221765767477205,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.239633560180664,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.95821484100673,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06623567640781403,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04133118316531181,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001491704024374485,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.5375945568084717,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05603087320923805,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.707361221313477,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.29306030273438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.10335401891253,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.427842140197754,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.564050540952334,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06774260103702545,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.042271509766578674,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014404978137463331,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.9407745599746704,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06722994893789291,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.345069885253906,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 76.1382827758789,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.77888065687268,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.040671348571777,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.71548813308608,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0659363865852356,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04114442691206932,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013583069667220116,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.079975128173828,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.069841668009758,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.290964126586914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.7518539428711,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.722887115839242,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.280155181884766,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.051427571763117,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06942862272262573,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.043323591351509094,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014623247552663088,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.7753446102142334,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06067285314202309,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.62651824951172,
      "model/normalizer/grad_frac": 0.2672411799430847,
      "model/normalizer/grad_norm": 0.16675898432731628,
      "model/normalizer/grad_zero_frac": 0.000252892030403018,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002132992260158062,
      "model/normalizer/weight_delta": 3.7757320404052734,
      "model/normalizer/weight_delta_rel": 0.048629242926836014,
      "model/normalizer/weight_norm": 78.18077087402344,
      "pose_mae_dtheta": 0.3325978219509125,
      "pose_mae_dx": 0.09288685023784637,
      "pose_mae_dy": 0.07362908124923706,
      "pose_rmse_dtheta": 0.5440211296081543,
      "pose_rmse_dx": 0.20160895586013794,
      "pose_rmse_dy": 0.1924915462732315,
      "pose_rmse_mean": 0.31270721554756165,
      "rmse_dtheta": 0.0579318031668663,
      "rmse_dx": 0.02310148999094963,
      "rmse_dy": 0.014983256347477436,
      "rmse_mean": 0.032005518674850464,
      "rotation_flip": 0.008746355772018433,
      "sparse_tokens": 12032.0,
      "step": 3375,
      "turn_loss": 0.3126481771469116,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 2946.0,
      "epoch": 0.15684816948522579,
      "grad_norm": 0.42042431235313416,
      "learning_rate": 8.259288951339233e-06,
      "loss": 0.1,
      "mae_dtheta": 0.022414594888687134,
      "mae_dx": 0.00719338608905673,
      "mae_dy": 0.006122246850281954,
      "pose_mae_dtheta": 0.16980914771556854,
      "pose_mae_dx": 0.08767010271549225,
      "pose_mae_dy": 0.07611260563135147,
      "pose_rmse_dtheta": 0.28680819272994995,
      "pose_rmse_dx": 0.1870155781507492,
      "pose_rmse_dy": 0.1552741825580597,
      "pose_rmse_mean": 0.20969931781291962,
      "rmse_dtheta": 0.0347617045044899,
      "rmse_dx": 0.017610911279916763,
      "rmse_dy": 0.010084372013807297,
      "rmse_mean": 0.02081899717450142,
      "rotation_flip": 0.007352941203862429,
      "sparse_tokens": 2558.0,
      "step": 3376,
      "turn_loss": 0.2137145698070526,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.15689462925106856,
      "grad_norm": 0.7245250344276428,
      "learning_rate": 8.258286144107277e-06,
      "loss": 0.1949,
      "mae_dtheta": 0.03775152564048767,
      "mae_dx": 0.011032560840249062,
      "mae_dy": 0.005546415224671364,
      "pose_mae_dtheta": 0.303805410861969,
      "pose_mae_dx": 0.09178710728883743,
      "pose_mae_dy": 0.05140284076333046,
      "pose_rmse_dtheta": 0.5307704210281372,
      "pose_rmse_dx": 0.19762587547302246,
      "pose_rmse_dy": 0.10130001604557037,
      "pose_rmse_mean": 0.27656543254852295,
      "rmse_dtheta": 0.05496543273329735,
      "rmse_dx": 0.02271146886050701,
      "rmse_dy": 0.011261009611189365,
      "rmse_mean": 0.029645970091223717,
      "rotation_flip": 0.02280130237340927,
      "sparse_tokens": 4902.0,
      "step": 3377,
      "turn_loss": 0.276918888092041,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.15694108901691137,
      "grad_norm": 0.3871113061904907,
      "learning_rate": 8.25728310902162e-06,
      "loss": 0.1321,
      "mae_dtheta": 0.029311010614037514,
      "mae_dx": 0.008506087586283684,
      "mae_dy": 0.005696859210729599,
      "pose_mae_dtheta": 0.23555032908916473,
      "pose_mae_dx": 0.08587419986724854,
      "pose_mae_dy": 0.07281245291233063,
      "pose_rmse_dtheta": 0.4008054733276367,
      "pose_rmse_dx": 0.18960922956466675,
      "pose_rmse_dy": 0.155668243765831,
      "pose_rmse_mean": 0.24869433045387268,
      "rmse_dtheta": 0.04594802483916283,
      "rmse_dx": 0.020135240629315376,
      "rmse_dy": 0.00982686411589384,
      "rmse_mean": 0.025303376838564873,
      "rotation_flip": 0.01256281416863203,
      "sparse_tokens": 7164.0,
      "step": 3378,
      "turn_loss": 0.26308268308639526,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.15698754878275414,
      "grad_norm": 0.6729592680931091,
      "learning_rate": 8.25627984615241e-06,
      "loss": 0.1695,
      "mae_dtheta": 0.010682583786547184,
      "mae_dx": 0.001948706922121346,
      "mae_dy": 0.00335972779430449,
      "pose_mae_dtheta": 0.0760875716805458,
      "pose_mae_dx": 0.03303232789039612,
      "pose_mae_dy": 0.04342978447675705,
      "pose_rmse_dtheta": 0.16235056519508362,
      "pose_rmse_dx": 0.085563525557518,
      "pose_rmse_dy": 0.09589996188879013,
      "pose_rmse_mean": 0.11460468173027039,
      "rmse_dtheta": 0.02061195857822895,
      "rmse_dx": 0.005799724254757166,
      "rmse_dy": 0.0069022704847157,
      "rmse_mean": 0.011104650795459747,
      "rotation_flip": 0.003937007859349251,
      "sparse_tokens": 32057.0,
      "step": 3379,
      "turn_loss": 0.08051929622888565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15703400854859692,
      "grad_norm": 0.439405620098114,
      "learning_rate": 8.255276355569801e-06,
      "loss": 0.1124,
      "mae_dtheta": 0.012013572268188,
      "mae_dx": 0.0019736047834157944,
      "mae_dy": 0.002734920009970665,
      "pose_mae_dtheta": 0.08093949407339096,
      "pose_mae_dx": 0.02678348869085312,
      "pose_mae_dy": 0.036356549710035324,
      "pose_rmse_dtheta": 0.17817647755146027,
      "pose_rmse_dx": 0.07301925867795944,
      "pose_rmse_dy": 0.07918758690357208,
      "pose_rmse_mean": 0.1101277694106102,
      "rmse_dtheta": 0.023522427305579185,
      "rmse_dx": 0.0061583383940160275,
      "rmse_dy": 0.00577186094596982,
      "rmse_mean": 0.01181754283607006,
      "rotation_flip": 0.006335797253996134,
      "sparse_tokens": 32105.0,
      "step": 3380,
      "turn_loss": 0.10350565612316132,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.1570804683144397,
      "grad_norm": 0.5830320119857788,
      "learning_rate": 8.254272637343968e-06,
      "loss": 0.131,
      "mae_dtheta": 0.0077918050810694695,
      "mae_dx": 0.002258693566545844,
      "mae_dy": 0.001267220824956894,
      "pose_mae_dtheta": 0.055095843970775604,
      "pose_mae_dx": 0.02435566671192646,
      "pose_mae_dy": 0.020645303651690483,
      "pose_rmse_dtheta": 0.11238543689250946,
      "pose_rmse_dx": 0.05768551677465439,
      "pose_rmse_dy": 0.05464355647563934,
      "pose_rmse_mean": 0.07490483671426773,
      "rmse_dtheta": 0.01647825352847576,
      "rmse_dx": 0.0061539593152701855,
      "rmse_dy": 0.0027600405737757683,
      "rmse_mean": 0.008464084938168526,
      "rotation_flip": 0.004924086853861809,
      "sparse_tokens": 32201.0,
      "step": 3381,
      "turn_loss": 0.0627913549542427,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.15712692808028247,
      "grad_norm": 0.5380188822746277,
      "learning_rate": 8.253268691545105e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.021423745900392532,
      "mae_dx": 0.011754839681088924,
      "mae_dy": 0.0017221797024831176,
      "pose_mae_dtheta": 0.15892906486988068,
      "pose_mae_dx": 0.09265533834695816,
      "pose_mae_dy": 0.022728145122528076,
      "pose_rmse_dtheta": 0.3112286925315857,
      "pose_rmse_dx": 0.24293531477451324,
      "pose_rmse_dy": 0.04092729091644287,
      "pose_rmse_mean": 0.1983637660741806,
      "rmse_dtheta": 0.037198081612586975,
      "rmse_dx": 0.025544216856360435,
      "rmse_dy": 0.002929120324552059,
      "rmse_mean": 0.02189047448337078,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 3986.0,
      "step": 3382,
      "turn_loss": 0.10407640039920807,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.15717338784612525,
      "grad_norm": 0.5527713298797607,
      "learning_rate": 8.252264518243414e-06,
      "loss": 0.152,
      "mae_dtheta": 0.04064944013953209,
      "mae_dx": 0.013878394849598408,
      "mae_dy": 0.0033404657151550055,
      "pose_mae_dtheta": 0.3540967106819153,
      "pose_mae_dx": 0.11640939861536026,
      "pose_mae_dy": 0.05015967786312103,
      "pose_rmse_dtheta": 0.6197935938835144,
      "pose_rmse_dx": 0.2699041962623596,
      "pose_rmse_dy": 0.12263025343418121,
      "pose_rmse_mean": 0.33744269609451294,
      "rmse_dtheta": 0.060839712619781494,
      "rmse_dx": 0.027446314692497253,
      "rmse_dy": 0.006479557603597641,
      "rmse_mean": 0.03158853203058243,
      "rotation_flip": 0.001347708865068853,
      "sparse_tokens": 12579.0,
      "step": 3383,
      "turn_loss": 0.2674415111541748,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.15721984761196803,
      "grad_norm": 0.47064274549484253,
      "learning_rate": 8.25126011750912e-06,
      "loss": 0.1347,
      "mae_dtheta": 0.005708982236683369,
      "mae_dx": 0.0012994768330827355,
      "mae_dy": 0.00032135433866642416,
      "pose_mae_dtheta": 0.04020478576421738,
      "pose_mae_dx": 0.010100805200636387,
      "pose_mae_dy": 0.004315811675041914,
      "pose_rmse_dtheta": 0.18546444177627563,
      "pose_rmse_dx": 0.026066502556204796,
      "pose_rmse_dy": 0.014457891695201397,
      "pose_rmse_mean": 0.07532961666584015,
      "rmse_dtheta": 0.022969374433159828,
      "rmse_dx": 0.0037572954315692186,
      "rmse_dy": 0.0009183420334011316,
      "rmse_mean": 0.009215004742145538,
      "rotation_flip": 0.0006523157353512943,
      "sparse_tokens": 32169.0,
      "step": 3384,
      "turn_loss": 0.03898753970861435,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1572663073778108,
      "grad_norm": 0.693078339099884,
      "learning_rate": 8.250255489412464e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.01120722759515047,
      "mae_dx": 0.003691603895276785,
      "mae_dy": 0.002262114081531763,
      "pose_mae_dtheta": 0.07729701697826385,
      "pose_mae_dx": 0.03397544100880623,
      "pose_mae_dy": 0.02742445468902588,
      "pose_rmse_dtheta": 0.21918471157550812,
      "pose_rmse_dx": 0.10892114043235779,
      "pose_rmse_dy": 0.08153675496578217,
      "pose_rmse_mean": 0.13654755055904388,
      "rmse_dtheta": 0.02838430553674698,
      "rmse_dx": 0.012337198480963707,
      "rmse_dy": 0.007478885818272829,
      "rmse_mean": 0.016066797077655792,
      "rotation_flip": 0.008762886747717857,
      "sparse_tokens": 32105.0,
      "step": 3385,
      "turn_loss": 0.1265530288219452,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.1573127671436536,
      "grad_norm": 0.3419588506221771,
      "learning_rate": 8.249250634023694e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.025417394936084747,
      "mae_dx": 0.006906554568558931,
      "mae_dy": 0.0024133604019880295,
      "pose_mae_dtheta": 0.16854074597358704,
      "pose_mae_dx": 0.05212980508804321,
      "pose_mae_dy": 0.02871391922235489,
      "pose_rmse_dtheta": 0.3385894000530243,
      "pose_rmse_dx": 0.11919575929641724,
      "pose_rmse_dy": 0.06750845164060593,
      "pose_rmse_mean": 0.17509786784648895,
      "rmse_dtheta": 0.0442039780318737,
      "rmse_dx": 0.0160011388361454,
      "rmse_dy": 0.004510680213570595,
      "rmse_mean": 0.0215719323605299,
      "rotation_flip": 0.01607142947614193,
      "sparse_tokens": 10458.0,
      "step": 3386,
      "turn_loss": 0.16333936154842377,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15735922690949639,
      "grad_norm": 0.3361149728298187,
      "learning_rate": 8.248245551413085e-06,
      "loss": 0.1058,
      "mae_dtheta": 0.007780218962579966,
      "mae_dx": 0.0019910903647542,
      "mae_dy": 0.001247132197022438,
      "pose_mae_dtheta": 0.0532958023250103,
      "pose_mae_dx": 0.020796461030840874,
      "pose_mae_dy": 0.019389014691114426,
      "pose_rmse_dtheta": 0.14602817595005035,
      "pose_rmse_dx": 0.05485798791050911,
      "pose_rmse_dy": 0.05440014973282814,
      "pose_rmse_mean": 0.08509543538093567,
      "rmse_dtheta": 0.01931897923350334,
      "rmse_dx": 0.00629068911075592,
      "rmse_dy": 0.003004893194884062,
      "rmse_mean": 0.009538187645375729,
      "rotation_flip": 0.0038419319316744804,
      "sparse_tokens": 32105.0,
      "step": 3387,
      "turn_loss": 0.07739405333995819,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.15740568667533916,
      "grad_norm": 0.7119211554527283,
      "learning_rate": 8.247240241650918e-06,
      "loss": 0.1723,
      "mae_dtheta": 0.05178992450237274,
      "mae_dx": 0.016606196761131287,
      "mae_dy": 0.0057323770597577095,
      "pose_mae_dtheta": 0.46385595202445984,
      "pose_mae_dx": 0.1372748464345932,
      "pose_mae_dy": 0.06991516053676605,
      "pose_rmse_dtheta": 0.7575061321258545,
      "pose_rmse_dx": 0.27965760231018066,
      "pose_rmse_dy": 0.15364384651184082,
      "pose_rmse_mean": 0.3969358801841736,
      "rmse_dtheta": 0.07055237144231796,
      "rmse_dx": 0.03017447516322136,
      "rmse_dy": 0.010251925326883793,
      "rmse_mean": 0.03699292242527008,
      "rotation_flip": 0.013189448043704033,
      "sparse_tokens": 13378.0,
      "step": 3388,
      "turn_loss": 0.3042465150356293,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.15745214644118194,
      "grad_norm": 0.8095928430557251,
      "learning_rate": 8.246234704807502e-06,
      "loss": 0.2859,
      "mae_dtheta": 0.024671634659171104,
      "mae_dx": 0.01068455446511507,
      "mae_dy": 0.0036888213362544775,
      "pose_mae_dtheta": 0.15999868512153625,
      "pose_mae_dx": 0.07859652489423752,
      "pose_mae_dy": 0.03592248633503914,
      "pose_rmse_dtheta": 0.2697452902793884,
      "pose_rmse_dx": 0.16682997345924377,
      "pose_rmse_dy": 0.08210242539644241,
      "pose_rmse_mean": 0.17289257049560547,
      "rmse_dtheta": 0.039774805307388306,
      "rmse_dx": 0.021201079711318016,
      "rmse_dy": 0.007190686650574207,
      "rmse_mean": 0.022722192108631134,
      "rotation_flip": 0.011673151515424252,
      "sparse_tokens": 8898.0,
      "step": 3389,
      "turn_loss": 0.24152903258800507,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 33413.0,
      "epoch": 0.15749860620702472,
      "grad_norm": 0.6325511932373047,
      "learning_rate": 8.245228940953146e-06,
      "loss": 0.21,
      "mae_dtheta": 0.03873030096292496,
      "mae_dx": 0.011338130570948124,
      "mae_dy": 0.005457677878439426,
      "pose_mae_dtheta": 0.2883889675140381,
      "pose_mae_dx": 0.09718844294548035,
      "pose_mae_dy": 0.054136257618665695,
      "pose_rmse_dtheta": 0.48913806676864624,
      "pose_rmse_dx": 0.2022383064031601,
      "pose_rmse_dy": 0.12260687351226807,
      "pose_rmse_mean": 0.27132776379585266,
      "rmse_dtheta": 0.05562721565365791,
      "rmse_dx": 0.022616621106863022,
      "rmse_dy": 0.010508701205253601,
      "rmse_mean": 0.029584180563688278,
      "rotation_flip": 0.010410287417471409,
      "sparse_tokens": 26213.0,
      "step": 3390,
      "turn_loss": 0.3266545534133911,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1575450659728675,
      "grad_norm": 0.8035483360290527,
      "learning_rate": 8.244222950158194e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.0085573960095644,
      "mae_dx": 0.0015334757044911385,
      "mae_dy": 0.001737926504574716,
      "pose_mae_dtheta": 0.060288555920124054,
      "pose_mae_dx": 0.016852587461471558,
      "pose_mae_dy": 0.023324815556406975,
      "pose_rmse_dtheta": 0.14485612511634827,
      "pose_rmse_dx": 0.040367498993873596,
      "pose_rmse_dy": 0.05876079946756363,
      "pose_rmse_mean": 0.0813281461596489,
      "rmse_dtheta": 0.019996454939246178,
      "rmse_dx": 0.004677025601267815,
      "rmse_dy": 0.004536584950983524,
      "rmse_mean": 0.009736688807606697,
      "rotation_flip": 0.004275331273674965,
      "sparse_tokens": 32105.0,
      "step": 3391,
      "turn_loss": 0.06600449979305267,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.15759152573871027,
      "grad_norm": 0.42522132396698,
      "learning_rate": 8.243216732492986e-06,
      "loss": 0.098,
      "mae_dtheta": 0.008723536506295204,
      "mae_dx": 0.0013797894353047013,
      "mae_dy": 0.002155124442651868,
      "pose_mae_dtheta": 0.057572927325963974,
      "pose_mae_dx": 0.020377112552523613,
      "pose_mae_dy": 0.028248002752661705,
      "pose_rmse_dtheta": 0.11267823725938797,
      "pose_rmse_dx": 0.05939331278204918,
      "pose_rmse_dy": 0.06361281126737595,
      "pose_rmse_mean": 0.0785614550113678,
      "rmse_dtheta": 0.016959525644779205,
      "rmse_dx": 0.004192958120256662,
      "rmse_dy": 0.0048738098703324795,
      "rmse_mean": 0.008675431832671165,
      "rotation_flip": 0.0016827934887260199,
      "sparse_tokens": 32057.0,
      "step": 3392,
      "turn_loss": 0.06867935508489609,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.15763798550455305,
      "grad_norm": 0.4672703742980957,
      "learning_rate": 8.242210288027893e-06,
      "loss": 0.0921,
      "mae_dtheta": 0.01160773541778326,
      "mae_dx": 0.001688866293989122,
      "mae_dy": 0.002127254381775856,
      "pose_mae_dtheta": 0.07434247434139252,
      "pose_mae_dx": 0.022018657997250557,
      "pose_mae_dy": 0.02585469000041485,
      "pose_rmse_dtheta": 0.18727917969226837,
      "pose_rmse_dx": 0.05144377052783966,
      "pose_rmse_dy": 0.056783076375722885,
      "pose_rmse_mean": 0.0985020101070404,
      "rmse_dtheta": 0.025310318917036057,
      "rmse_dx": 0.0048976619727909565,
      "rmse_dy": 0.0043434398248791695,
      "rmse_mean": 0.011517140083014965,
      "rotation_flip": 0.0028500177431851625,
      "sparse_tokens": 32137.0,
      "step": 3393,
      "turn_loss": 0.08260934799909592,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34389.0,
      "epoch": 0.15768444527039585,
      "grad_norm": 0.7165341973304749,
      "learning_rate": 8.241203616833294e-06,
      "loss": 0.2255,
      "mae_dtheta": 0.03562384098768234,
      "mae_dx": 0.015405502170324326,
      "mae_dy": 0.00764641584828496,
      "pose_mae_dtheta": 0.2875431180000305,
      "pose_mae_dx": 0.13814428448677063,
      "pose_mae_dy": 0.0809783935546875,
      "pose_rmse_dtheta": 0.45739924907684326,
      "pose_rmse_dx": 0.267120897769928,
      "pose_rmse_dy": 0.2150198221206665,
      "pose_rmse_mean": 0.31317999958992004,
      "rmse_dtheta": 0.050785165280103683,
      "rmse_dx": 0.026574553921818733,
      "rmse_dy": 0.016661513596773148,
      "rmse_mean": 0.03134041279554367,
      "rotation_flip": 0.019596541300415993,
      "sparse_tokens": 26738.0,
      "step": 3394,
      "turn_loss": 0.367058664560318,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15773090503623863,
      "grad_norm": 0.47401997447013855,
      "learning_rate": 8.240196718979586e-06,
      "loss": 0.1068,
      "mae_dtheta": 0.012237024493515491,
      "mae_dx": 0.0023964555002748966,
      "mae_dy": 0.002639302983880043,
      "pose_mae_dtheta": 0.07894692569971085,
      "pose_mae_dx": 0.0260165985673666,
      "pose_mae_dy": 0.03183615580201149,
      "pose_rmse_dtheta": 0.1740960329771042,
      "pose_rmse_dx": 0.06398074328899384,
      "pose_rmse_dy": 0.06903419643640518,
      "pose_rmse_mean": 0.10237032175064087,
      "rmse_dtheta": 0.02418149635195732,
      "rmse_dx": 0.007194994017481804,
      "rmse_dy": 0.005191822536289692,
      "rmse_mean": 0.012189436703920364,
      "rotation_flip": 0.006988120265305042,
      "sparse_tokens": 32121.0,
      "step": 3395,
      "turn_loss": 0.11588723957538605,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1577773648020814,
      "grad_norm": 0.4571751058101654,
      "learning_rate": 8.239189594537181e-06,
      "loss": 0.1214,
      "mae_dtheta": 0.009772680699825287,
      "mae_dx": 0.0020622964948415756,
      "mae_dy": 0.002457421738654375,
      "pose_mae_dtheta": 0.06977655738592148,
      "pose_mae_dx": 0.02150520123541355,
      "pose_mae_dy": 0.02735920064151287,
      "pose_rmse_dtheta": 0.17089872062206268,
      "pose_rmse_dx": 0.05162212252616882,
      "pose_rmse_dy": 0.06390424817800522,
      "pose_rmse_mean": 0.09547503292560577,
      "rmse_dtheta": 0.022727642208337784,
      "rmse_dx": 0.0062126051634550095,
      "rmse_dy": 0.006567295175045729,
      "rmse_mean": 0.011835847049951553,
      "rotation_flip": 0.005641218274831772,
      "sparse_tokens": 32169.0,
      "step": 3396,
      "turn_loss": 0.09263187646865845,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23367.0,
      "epoch": 0.15782382456792418,
      "grad_norm": 0.5542195439338684,
      "learning_rate": 8.238182243576512e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.04110346734523773,
      "mae_dx": 0.01252959854900837,
      "mae_dy": 0.005324515979737043,
      "pose_mae_dtheta": 0.31035465002059937,
      "pose_mae_dx": 0.09213685244321823,
      "pose_mae_dy": 0.06461618095636368,
      "pose_rmse_dtheta": 0.5471095442771912,
      "pose_rmse_dx": 0.18717123568058014,
      "pose_rmse_dy": 0.16314826905727386,
      "pose_rmse_mean": 0.2991430163383484,
      "rmse_dtheta": 0.0616142675280571,
      "rmse_dx": 0.024756373837590218,
      "rmse_dy": 0.011064281687140465,
      "rmse_mean": 0.03247831016778946,
      "rotation_flip": 0.013477088883519173,
      "sparse_tokens": 20477.0,
      "step": 3397,
      "turn_loss": 0.26917704939842224,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.15787028433376696,
      "grad_norm": 0.6011302471160889,
      "learning_rate": 8.237174666168018e-06,
      "loss": 0.1561,
      "mae_dtheta": 0.02865181490778923,
      "mae_dx": 0.004547060467302799,
      "mae_dy": 0.005710176657885313,
      "pose_mae_dtheta": 0.1854318082332611,
      "pose_mae_dx": 0.0472908616065979,
      "pose_mae_dy": 0.09892932325601578,
      "pose_rmse_dtheta": 0.25921475887298584,
      "pose_rmse_dx": 0.09029842168092728,
      "pose_rmse_dy": 0.18689213693141937,
      "pose_rmse_mean": 0.1788017749786377,
      "rmse_dtheta": 0.04230324551463127,
      "rmse_dx": 0.011795375496149063,
      "rmse_dy": 0.0099048912525177,
      "rmse_mean": 0.021334504708647728,
      "rotation_flip": 0.0,
      "sparse_tokens": 4557.0,
      "step": 3398,
      "turn_loss": 0.2472343146800995,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15791674409960973,
      "grad_norm": 0.9504279494285583,
      "learning_rate": 8.236166862382163e-06,
      "loss": 0.1576,
      "mae_dtheta": 0.013091253116726875,
      "mae_dx": 0.0020024897530674934,
      "mae_dy": 0.0029762755148112774,
      "pose_mae_dtheta": 0.08689424395561218,
      "pose_mae_dx": 0.028517095372080803,
      "pose_mae_dy": 0.03945338353514671,
      "pose_rmse_dtheta": 0.19980350136756897,
      "pose_rmse_dx": 0.06072409078478813,
      "pose_rmse_dy": 0.0851423367857933,
      "pose_rmse_mean": 0.11522331088781357,
      "rmse_dtheta": 0.026089783757925034,
      "rmse_dx": 0.005437538493424654,
      "rmse_dy": 0.005428155418485403,
      "rmse_mean": 0.01231849193572998,
      "rotation_flip": 0.009677419438958168,
      "sparse_tokens": 32121.0,
      "step": 3399,
      "turn_loss": 0.11648866534233093,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.1579632038654525,
      "grad_norm": 0.44685232639312744,
      "learning_rate": 8.235158832289423e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.032561045140028,
      "mae_dx": 0.005704090930521488,
      "mae_dy": 0.005753028206527233,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44685232639312744,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.45639038085938,
      "model/head/act_norm_mean": 107.9751864346591,
      "model/head/act_norm_min": 75.0259017944336,
      "model/head/act_over_embed": 74.2015589975198,
      "model/head/grad_frac": 0.11627636849880219,
      "model/head/grad_norm": 0.051958367228507996,
      "model/head/grad_zero_frac": 0.00017703764024190605,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6776899857954546,
      "model/head/update_ratio": 0.000895132718142122,
      "model/head/weight_delta": 6.858997821807861,
      "model/head/weight_delta_rel": 0.12032713741064072,
      "model/head/weight_norm": 58.045433044433594,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4167174696922302,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41665956248407776,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41661494970321655,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28633235216734076,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0858858972787857,
      "model/modality_embedder.encoders.pose/grad_norm": 0.038378313183784485,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5458559782608695,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012443135492503643,
      "model/modality_embedder.encoders.pose/weight_delta": 2.249420642852783,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07349558174610138,
      "model/modality_embedder.encoders.pose/weight_norm": 30.842960357666016,
      "model/modality_embedder/grad_frac": 0.0858858972787857,
      "model/modality_embedder/grad_norm": 0.038378313183784485,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5458559782608695,
      "model/modality_embedder/update_ratio": 0.0012443135492503643,
      "model/modality_embedder/weight_delta": 2.249420642852783,
      "model/modality_embedder/weight_delta_rel": 0.07349558174610138,
      "model/modality_embedder/weight_norm": 30.842960357666016,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.76133728027344,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.33241736562049,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.300098419189453,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.03425565518738,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08769598603248596,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03918715566396713,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014142538420856,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.546319842338562,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05634882673621178,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.70871353149414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.37422943115234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.27125890602453,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.917128562927246,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.67943635132602,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08702287077903748,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03888637199997902,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001325026387348771,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.952597975730896,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06763952225446701,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.34762191772461,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.03313446044922,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.044394841269842,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.417028427124023,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.897951966386767,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08445844054222107,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.037740450352430344,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00124580436386168,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.092120409011841,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07024948298931122,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.294042587280273,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.01185607910156,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.963039998196248,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.507048606872559,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.216462880865556,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08522560447454453,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.038083259016275406,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001285314792767167,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.7862383127212524,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.061045147478580475,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.629518508911133,
      "model/normalizer/grad_frac": 0.33821696043014526,
      "model/normalizer/grad_norm": 0.15113303065299988,
      "model/normalizer/grad_zero_frac": 0.00016780685109551996,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0019330414943397045,
      "model/normalizer/weight_delta": 3.7980828285217285,
      "model/normalizer/weight_delta_rel": 0.04891710728406906,
      "model/normalizer/weight_norm": 78.1840591430664,
      "pose_mae_dtheta": 0.27005141973495483,
      "pose_mae_dx": 0.057413250207901,
      "pose_mae_dy": 0.06098038703203201,
      "pose_rmse_dtheta": 0.4292416572570801,
      "pose_rmse_dx": 0.1313786655664444,
      "pose_rmse_dy": 0.11724726110696793,
      "pose_rmse_mean": 0.22595587372779846,
      "rmse_dtheta": 0.048269305378198624,
      "rmse_dx": 0.012750061228871346,
      "rmse_dy": 0.011346302926540375,
      "rmse_mean": 0.02412189170718193,
      "rotation_flip": 0.01373626384884119,
      "sparse_tokens": 6249.0,
      "step": 3400,
      "turn_loss": 0.262078195810318,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "epoch": 0.1579632038654525,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31558459997177124,
      "eval_objectnav_nopose_mae_dtheta": 0.04119065776467323,
      "eval_objectnav_nopose_mae_dx": 0.013721019960939884,
      "eval_objectnav_nopose_mae_dy": 0.005281407386064529,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3320982754230499,
      "eval_objectnav_nopose_pose_mae_dx": 0.1103719025850296,
      "eval_objectnav_nopose_pose_mae_dy": 0.05860256776213646,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5551809668540955,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2390720695257187,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1380685269832611,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3107738494873047,
      "eval_objectnav_nopose_rmse_dtheta": 0.058949291706085205,
      "eval_objectnav_nopose_rmse_dx": 0.026495952159166336,
      "eval_objectnav_nopose_rmse_dy": 0.010735463351011276,
      "eval_objectnav_nopose_rmse_mean": 0.03206023573875427,
      "eval_objectnav_nopose_rotation_flip": 0.015855904668569565,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31558459997177124,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 3400
    },
    {
      "epoch": 0.1579632038654525,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28753554821014404,
      "eval_objectnav_pose_mae_dtheta": 0.03692688047885895,
      "eval_objectnav_pose_mae_dx": 0.0118052763864398,
      "eval_objectnav_pose_mae_dy": 0.004931224975734949,
      "eval_objectnav_pose_pose_mae_dtheta": 0.28379955887794495,
      "eval_objectnav_pose_pose_mae_dx": 0.09110675007104874,
      "eval_objectnav_pose_pose_mae_dy": 0.05197218805551529,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4903022050857544,
      "eval_objectnav_pose_pose_rmse_dx": 0.21232371032238007,
      "eval_objectnav_pose_pose_rmse_dy": 0.12318326532840729,
      "eval_objectnav_pose_pose_rmse_mean": 0.2752697467803955,
      "eval_objectnav_pose_rmse_dtheta": 0.05443818122148514,
      "eval_objectnav_pose_rmse_dx": 0.024212071672081947,
      "eval_objectnav_pose_rmse_dy": 0.01004490815103054,
      "eval_objectnav_pose_rmse_mean": 0.029565054923295975,
      "eval_objectnav_pose_rotation_flip": 0.016468470916152,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28753554821014404,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 3400
    },
    {
      "epoch": 0.1579632038654525,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10119406878948212,
      "eval_pointnav_mae_dtheta": 0.011453034356236458,
      "eval_pointnav_mae_dx": 0.0026629818603396416,
      "eval_pointnav_mae_dy": 0.002738510025665164,
      "eval_pointnav_pose_mae_dtheta": 0.08167148381471634,
      "eval_pointnav_pose_mae_dx": 0.030198976397514343,
      "eval_pointnav_pose_mae_dy": 0.031485024839639664,
      "eval_pointnav_pose_rmse_dtheta": 0.21698863804340363,
      "eval_pointnav_pose_rmse_dx": 0.09048550575971603,
      "eval_pointnav_pose_rmse_dy": 0.08478369563817978,
      "eval_pointnav_pose_rmse_mean": 0.13075262308120728,
      "eval_pointnav_rmse_dtheta": 0.02667403779923916,
      "eval_pointnav_rmse_dx": 0.008120548911392689,
      "eval_pointnav_rmse_dy": 0.0069724698550999165,
      "eval_pointnav_rmse_mean": 0.013922352343797684,
      "eval_pointnav_rotation_flip": 0.0053650205954909325,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10119406878948212,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 3400
    },
    {
      "epoch": 0.1579632038654525,
      "eval_loss": 0.23477140565713248,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31558459997177124,
      "eval_objectnav_nopose_mae_dtheta": 0.04119065776467323,
      "eval_objectnav_nopose_mae_dx": 0.013721019960939884,
      "eval_objectnav_nopose_mae_dy": 0.005281407386064529,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3320982754230499,
      "eval_objectnav_nopose_pose_mae_dx": 0.1103719025850296,
      "eval_objectnav_nopose_pose_mae_dy": 0.05860256776213646,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5551809668540955,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2390720695257187,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1380685269832611,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3107738494873047,
      "eval_objectnav_nopose_rmse_dtheta": 0.058949291706085205,
      "eval_objectnav_nopose_rmse_dx": 0.026495952159166336,
      "eval_objectnav_nopose_rmse_dy": 0.010735463351011276,
      "eval_objectnav_nopose_rmse_mean": 0.03206023573875427,
      "eval_objectnav_nopose_rotation_flip": 0.015855904668569565,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31558459997177124,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28753554821014404,
      "eval_objectnav_pose_mae_dtheta": 0.03692688047885895,
      "eval_objectnav_pose_mae_dx": 0.0118052763864398,
      "eval_objectnav_pose_mae_dy": 0.004931224975734949,
      "eval_objectnav_pose_pose_mae_dtheta": 0.28379955887794495,
      "eval_objectnav_pose_pose_mae_dx": 0.09110675007104874,
      "eval_objectnav_pose_pose_mae_dy": 0.05197218805551529,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4903022050857544,
      "eval_objectnav_pose_pose_rmse_dx": 0.21232371032238007,
      "eval_objectnav_pose_pose_rmse_dy": 0.12318326532840729,
      "eval_objectnav_pose_pose_rmse_mean": 0.2752697467803955,
      "eval_objectnav_pose_rmse_dtheta": 0.05443818122148514,
      "eval_objectnav_pose_rmse_dx": 0.024212071672081947,
      "eval_objectnav_pose_rmse_dy": 0.01004490815103054,
      "eval_objectnav_pose_rmse_mean": 0.029565054923295975,
      "eval_objectnav_pose_rotation_flip": 0.016468470916152,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28753554821014404,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10119406878948212,
      "eval_pointnav_mae_dtheta": 0.011453034356236458,
      "eval_pointnav_mae_dx": 0.0026629818603396416,
      "eval_pointnav_mae_dy": 0.002738510025665164,
      "eval_pointnav_pose_mae_dtheta": 0.08167148381471634,
      "eval_pointnav_pose_mae_dx": 0.030198976397514343,
      "eval_pointnav_pose_mae_dy": 0.031485024839639664,
      "eval_pointnav_pose_rmse_dtheta": 0.21698863804340363,
      "eval_pointnav_pose_rmse_dx": 0.09048550575971603,
      "eval_pointnav_pose_rmse_dy": 0.08478369563817978,
      "eval_pointnav_pose_rmse_mean": 0.13075262308120728,
      "eval_pointnav_rmse_dtheta": 0.02667403779923916,
      "eval_pointnav_rmse_dx": 0.008120548911392689,
      "eval_pointnav_rmse_dy": 0.0069724698550999165,
      "eval_pointnav_rmse_mean": 0.013922352343797684,
      "eval_pointnav_rotation_flip": 0.0053650205954909325,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10119406878948212,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 3400
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.1580096636312953,
      "grad_norm": 0.38138020038604736,
      "learning_rate": 8.234150575960288e-06,
      "loss": 0.1331,
      "mae_dtheta": 0.03775915876030922,
      "mae_dx": 0.013646936044096947,
      "mae_dy": 0.004488635342568159,
      "pose_mae_dtheta": 0.31954267621040344,
      "pose_mae_dx": 0.10706741362810135,
      "pose_mae_dy": 0.049880944192409515,
      "pose_rmse_dtheta": 0.5521696209907532,
      "pose_rmse_dx": 0.2423875778913498,
      "pose_rmse_dy": 0.11285743862390518,
      "pose_rmse_mean": 0.3024715781211853,
      "rmse_dtheta": 0.057411711663007736,
      "rmse_dx": 0.02702050283551216,
      "rmse_dy": 0.008174870163202286,
      "rmse_mean": 0.030869027599692345,
      "rotation_flip": 0.01657000742852688,
      "sparse_tokens": 21595.0,
      "step": 3401,
      "turn_loss": 0.2596384584903717,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15805612339713807,
      "grad_norm": 0.45197319984436035,
      "learning_rate": 8.233142093465269e-06,
      "loss": 0.107,
      "mae_dtheta": 0.00640698941424489,
      "mae_dx": 0.0017695099813863635,
      "mae_dy": 0.0012805876322090626,
      "pose_mae_dtheta": 0.04786809906363487,
      "pose_mae_dx": 0.017002372071146965,
      "pose_mae_dy": 0.020793825387954712,
      "pose_rmse_dtheta": 0.13644908368587494,
      "pose_rmse_dx": 0.05101656913757324,
      "pose_rmse_dy": 0.06359092891216278,
      "pose_rmse_mean": 0.08368553221225739,
      "rmse_dtheta": 0.017636211588978767,
      "rmse_dx": 0.005662917159497738,
      "rmse_dy": 0.0032908159773796797,
      "rmse_mean": 0.008863314986228943,
      "rotation_flip": 0.0041011618450284,
      "sparse_tokens": 32121.0,
      "step": 3402,
      "turn_loss": 0.052005451172590256,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15810258316298087,
      "grad_norm": 0.5700414776802063,
      "learning_rate": 8.232133384874887e-06,
      "loss": 0.1243,
      "mae_dtheta": 0.010806160047650337,
      "mae_dx": 0.002074370626360178,
      "mae_dy": 0.0025922295171767473,
      "pose_mae_dtheta": 0.07985714823007584,
      "pose_mae_dx": 0.02205035276710987,
      "pose_mae_dy": 0.02581220306456089,
      "pose_rmse_dtheta": 0.23317235708236694,
      "pose_rmse_dx": 0.07083018869161606,
      "pose_rmse_dy": 0.055358488112688065,
      "pose_rmse_mean": 0.11978702247142792,
      "rmse_dtheta": 0.02599792182445526,
      "rmse_dx": 0.006345817353576422,
      "rmse_dy": 0.007573212496936321,
      "rmse_mean": 0.013305651023983955,
      "rotation_flip": 0.003267973894253373,
      "sparse_tokens": 32105.0,
      "step": 3403,
      "turn_loss": 0.08697663247585297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.15814904292882365,
      "grad_norm": 0.5823184847831726,
      "learning_rate": 8.231124450259683e-06,
      "loss": 0.2017,
      "mae_dtheta": 0.028015676885843277,
      "mae_dx": 0.010344809852540493,
      "mae_dy": 0.004931632429361343,
      "pose_mae_dtheta": 0.20229026675224304,
      "pose_mae_dx": 0.07780668139457703,
      "pose_mae_dy": 0.0666348934173584,
      "pose_rmse_dtheta": 0.3864808976650238,
      "pose_rmse_dx": 0.18828964233398438,
      "pose_rmse_dy": 0.1488848775625229,
      "pose_rmse_mean": 0.24121849238872528,
      "rmse_dtheta": 0.045135922729969025,
      "rmse_dx": 0.023218626156449318,
      "rmse_dy": 0.009545031003654003,
      "rmse_mean": 0.025966525077819824,
      "rotation_flip": 0.012583271600306034,
      "sparse_tokens": 22327.0,
      "step": 3404,
      "turn_loss": 0.2635250389575958,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 36013.0,
      "epoch": 0.15819550269466642,
      "grad_norm": 0.8715596199035645,
      "learning_rate": 8.230115289690212e-06,
      "loss": 0.2175,
      "mae_dtheta": 0.02999478578567505,
      "mae_dx": 0.011178705841302872,
      "mae_dy": 0.005258879158645868,
      "pose_mae_dtheta": 0.2214333862066269,
      "pose_mae_dx": 0.09445003420114517,
      "pose_mae_dy": 0.05622255057096481,
      "pose_rmse_dtheta": 0.408037394285202,
      "pose_rmse_dx": 0.22283212840557098,
      "pose_rmse_dy": 0.12892301380634308,
      "pose_rmse_mean": 0.2532641887664795,
      "rmse_dtheta": 0.047303520143032074,
      "rmse_dx": 0.0237770713865757,
      "rmse_dy": 0.010797904804348946,
      "rmse_mean": 0.027292832732200623,
      "rotation_flip": 0.010152284055948257,
      "sparse_tokens": 29713.0,
      "step": 3405,
      "turn_loss": 0.21230056881904602,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1582419624605092,
      "grad_norm": 0.4805949330329895,
      "learning_rate": 8.229105903237045e-06,
      "loss": 0.091,
      "mae_dtheta": 0.01015273854136467,
      "mae_dx": 0.0017663143808022141,
      "mae_dy": 0.0024182992056012154,
      "pose_mae_dtheta": 0.06728768348693848,
      "pose_mae_dx": 0.022222191095352173,
      "pose_mae_dy": 0.03172185271978378,
      "pose_rmse_dtheta": 0.1773354858160019,
      "pose_rmse_dx": 0.0818367600440979,
      "pose_rmse_dy": 0.09447628259658813,
      "pose_rmse_mean": 0.11788284778594971,
      "rmse_dtheta": 0.02383202500641346,
      "rmse_dx": 0.006385372951626778,
      "rmse_dy": 0.007063745986670256,
      "rmse_mean": 0.01242704875767231,
      "rotation_flip": 0.002735978225246072,
      "sparse_tokens": 32073.0,
      "step": 3406,
      "turn_loss": 0.08615660667419434,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15828842222635198,
      "grad_norm": 0.5696793794631958,
      "learning_rate": 8.228096290970768e-06,
      "loss": 0.1709,
      "mae_dtheta": 0.014397894963622093,
      "mae_dx": 0.002500183880329132,
      "mae_dy": 0.003211519680917263,
      "pose_mae_dtheta": 0.11447735875844955,
      "pose_mae_dx": 0.03351256996393204,
      "pose_mae_dy": 0.03704933449625969,
      "pose_rmse_dtheta": 0.28445565700531006,
      "pose_rmse_dx": 0.10052820295095444,
      "pose_rmse_dy": 0.10714636743068695,
      "pose_rmse_mean": 0.16404341161251068,
      "rmse_dtheta": 0.030666230246424675,
      "rmse_dx": 0.007297646254301071,
      "rmse_dy": 0.008442701771855354,
      "rmse_mean": 0.015468858182430267,
      "rotation_flip": 0.004359888844192028,
      "sparse_tokens": 32121.0,
      "step": 3407,
      "turn_loss": 0.09910929948091507,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19096.0,
      "epoch": 0.15833488199219475,
      "grad_norm": 0.6769540905952454,
      "learning_rate": 8.227086452961985e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.03160015121102333,
      "mae_dx": 0.016191212460398674,
      "mae_dy": 0.008846450597047806,
      "pose_mae_dtheta": 0.24941770732402802,
      "pose_mae_dx": 0.12936030328273773,
      "pose_mae_dy": 0.09892582148313522,
      "pose_rmse_dtheta": 0.4434109926223755,
      "pose_rmse_dx": 0.28853315114974976,
      "pose_rmse_dy": 0.2192264050245285,
      "pose_rmse_mean": 0.3170568645000458,
      "rmse_dtheta": 0.048976004123687744,
      "rmse_dx": 0.030379850417375565,
      "rmse_dy": 0.017239712178707123,
      "rmse_mean": 0.03219852223992348,
      "rotation_flip": 0.015819208696484566,
      "sparse_tokens": 15709.0,
      "step": 3408,
      "turn_loss": 0.29972749948501587,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.15838134175803753,
      "grad_norm": 0.43387410044670105,
      "learning_rate": 8.226076389281316e-06,
      "loss": 0.1005,
      "mae_dtheta": 0.024466615170240402,
      "mae_dx": 0.008643273264169693,
      "mae_dy": 0.0035254121758043766,
      "pose_mae_dtheta": 0.19691146910190582,
      "pose_mae_dx": 0.06744140386581421,
      "pose_mae_dy": 0.039079345762729645,
      "pose_rmse_dtheta": 0.4006567597389221,
      "pose_rmse_dx": 0.17263928055763245,
      "pose_rmse_dy": 0.10605823993682861,
      "pose_rmse_mean": 0.22645144164562225,
      "rmse_dtheta": 0.042797885835170746,
      "rmse_dx": 0.02039560303092003,
      "rmse_dy": 0.008169676177203655,
      "rmse_mean": 0.023787720128893852,
      "rotation_flip": 0.012704174034297466,
      "sparse_tokens": 21736.0,
      "step": 3409,
      "turn_loss": 0.20648105442523956,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1584278015238803,
      "grad_norm": 0.36354973912239075,
      "learning_rate": 8.225066099999392e-06,
      "loss": 0.1054,
      "mae_dtheta": 0.00709842424839735,
      "mae_dx": 0.001425097230821848,
      "mae_dy": 0.000815480190794915,
      "pose_mae_dtheta": 0.05401700735092163,
      "pose_mae_dx": 0.013167936354875565,
      "pose_mae_dy": 0.011499990709125996,
      "pose_rmse_dtheta": 0.20369026064872742,
      "pose_rmse_dx": 0.03241332247853279,
      "pose_rmse_dy": 0.03244571387767792,
      "pose_rmse_mean": 0.08951643109321594,
      "rmse_dtheta": 0.02384062483906746,
      "rmse_dx": 0.004246305208653212,
      "rmse_dy": 0.002059502527117729,
      "rmse_mean": 0.010048811323940754,
      "rotation_flip": 0.0021598271559923887,
      "sparse_tokens": 32169.0,
      "step": 3410,
      "turn_loss": 0.03993413969874382,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1584742612897231,
      "grad_norm": 0.5266832113265991,
      "learning_rate": 8.224055585186866e-06,
      "loss": 0.181,
      "mae_dtheta": 0.009735913015902042,
      "mae_dx": 0.0015016983961686492,
      "mae_dy": 0.0016311241779476404,
      "pose_mae_dtheta": 0.07222510874271393,
      "pose_mae_dx": 0.017703615128993988,
      "pose_mae_dy": 0.023098651319742203,
      "pose_rmse_dtheta": 0.20424431562423706,
      "pose_rmse_dx": 0.049221139401197433,
      "pose_rmse_dy": 0.060186855494976044,
      "pose_rmse_mean": 0.10455077141523361,
      "rmse_dtheta": 0.024021534249186516,
      "rmse_dx": 0.005114458501338959,
      "rmse_dy": 0.0035126234870404005,
      "rmse_mean": 0.01088287215679884,
      "rotation_flip": 0.0013805798953399062,
      "sparse_tokens": 32105.0,
      "step": 3411,
      "turn_loss": 0.0697353407740593,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32114.0,
      "epoch": 0.1585207210555659,
      "grad_norm": 0.5546700358390808,
      "learning_rate": 8.223044844914402e-06,
      "loss": 0.1645,
      "mae_dtheta": 0.027310719713568687,
      "mae_dx": 0.011548577807843685,
      "mae_dy": 0.004110055975615978,
      "pose_mae_dtheta": 0.2021646797657013,
      "pose_mae_dx": 0.09128651022911072,
      "pose_mae_dy": 0.04111097380518913,
      "pose_rmse_dtheta": 0.35976070165634155,
      "pose_rmse_dx": 0.2045045793056488,
      "pose_rmse_dy": 0.09760744869709015,
      "pose_rmse_mean": 0.22062423825263977,
      "rmse_dtheta": 0.044010311365127563,
      "rmse_dx": 0.023657334968447685,
      "rmse_dy": 0.009402924217283726,
      "rmse_mean": 0.025690190494060516,
      "rotation_flip": 0.01156812347471714,
      "sparse_tokens": 25910.0,
      "step": 3412,
      "turn_loss": 0.27113714814186096,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.15856718082140867,
      "grad_norm": 0.45640116930007935,
      "learning_rate": 8.22203387925268e-06,
      "loss": 0.0839,
      "mae_dtheta": 0.00691563356667757,
      "mae_dx": 0.0014163361629471183,
      "mae_dy": 0.001389545970596373,
      "pose_mae_dtheta": 0.05133317783474922,
      "pose_mae_dx": 0.015539957210421562,
      "pose_mae_dy": 0.020672760903835297,
      "pose_rmse_dtheta": 0.10293204337358475,
      "pose_rmse_dx": 0.03553321957588196,
      "pose_rmse_dy": 0.04690329730510712,
      "pose_rmse_mean": 0.06178952008485794,
      "rmse_dtheta": 0.014407917857170105,
      "rmse_dx": 0.004692082293331623,
      "rmse_dy": 0.002703338395804167,
      "rmse_mean": 0.007267779670655727,
      "rotation_flip": 0.0028294259682297707,
      "sparse_tokens": 32153.0,
      "step": 3413,
      "turn_loss": 0.05650760233402252,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15861364058725144,
      "grad_norm": 0.5714560747146606,
      "learning_rate": 8.221022688272401e-06,
      "loss": 0.1497,
      "mae_dtheta": 0.014880077913403511,
      "mae_dx": 0.003951298072934151,
      "mae_dy": 0.005139445420354605,
      "pose_mae_dtheta": 0.10786722600460052,
      "pose_mae_dx": 0.04181062802672386,
      "pose_mae_dy": 0.05003637447953224,
      "pose_rmse_dtheta": 0.2301347255706787,
      "pose_rmse_dx": 0.10433141142129898,
      "pose_rmse_dy": 0.12481211125850677,
      "pose_rmse_mean": 0.15309274196624756,
      "rmse_dtheta": 0.02824646793305874,
      "rmse_dx": 0.010574466548860073,
      "rmse_dy": 0.011371595785021782,
      "rmse_mean": 0.016730843111872673,
      "rotation_flip": 0.00620664469897747,
      "sparse_tokens": 32105.0,
      "step": 3414,
      "turn_loss": 0.1603582352399826,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.15866010035309422,
      "grad_norm": 0.6609876751899719,
      "learning_rate": 8.220011272044276e-06,
      "loss": 0.257,
      "mae_dtheta": 0.03427046537399292,
      "mae_dx": 0.010135792195796967,
      "mae_dy": 0.006742564961314201,
      "pose_mae_dtheta": 0.30105429887771606,
      "pose_mae_dx": 0.08243567496538162,
      "pose_mae_dy": 0.09100201725959778,
      "pose_rmse_dtheta": 0.49021071195602417,
      "pose_rmse_dx": 0.17903055250644684,
      "pose_rmse_dy": 0.20716898143291473,
      "pose_rmse_mean": 0.2921367585659027,
      "rmse_dtheta": 0.050129618495702744,
      "rmse_dx": 0.02101404033601284,
      "rmse_dy": 0.013024142012000084,
      "rmse_mean": 0.028055934235453606,
      "rotation_flip": 0.013333333656191826,
      "sparse_tokens": 16627.0,
      "step": 3415,
      "turn_loss": 0.28513041138648987,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.158706560118937,
      "grad_norm": 0.5598484873771667,
      "learning_rate": 8.218999630639037e-06,
      "loss": 0.1257,
      "mae_dtheta": 0.040762390941381454,
      "mae_dx": 0.011518379673361778,
      "mae_dy": 0.006085838656872511,
      "pose_mae_dtheta": 0.3575982451438904,
      "pose_mae_dx": 0.10003750771284103,
      "pose_mae_dy": 0.08918466418981552,
      "pose_rmse_dtheta": 0.6259739995002747,
      "pose_rmse_dx": 0.21504569053649902,
      "pose_rmse_dy": 0.1727372407913208,
      "pose_rmse_mean": 0.3379189968109131,
      "rmse_dtheta": 0.059988245368003845,
      "rmse_dx": 0.024007223546504974,
      "rmse_dy": 0.009485412389039993,
      "rmse_mean": 0.031160295009613037,
      "rotation_flip": 0.017391303554177284,
      "sparse_tokens": 11741.0,
      "step": 3416,
      "turn_loss": 0.2546902000904083,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 16512.0,
      "epoch": 0.15875301988477977,
      "grad_norm": 0.609379768371582,
      "learning_rate": 8.217987764127423e-06,
      "loss": 0.1288,
      "mae_dtheta": 0.030128221958875656,
      "mae_dx": 0.009329644031822681,
      "mae_dy": 0.004527635406702757,
      "pose_mae_dtheta": 0.23312444984912872,
      "pose_mae_dx": 0.07234465330839157,
      "pose_mae_dy": 0.05961613357067108,
      "pose_rmse_dtheta": 0.43714064359664917,
      "pose_rmse_dx": 0.17588399350643158,
      "pose_rmse_dy": 0.1326712965965271,
      "pose_rmse_mean": 0.24856531620025635,
      "rmse_dtheta": 0.04760845750570297,
      "rmse_dx": 0.021082554012537003,
      "rmse_dy": 0.007617494091391563,
      "rmse_mean": 0.025436170399188995,
      "rotation_flip": 0.007496251724660397,
      "sparse_tokens": 12741.0,
      "step": 3417,
      "turn_loss": 0.22235043346881866,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15879947965062255,
      "grad_norm": 0.5256879925727844,
      "learning_rate": 8.2169756725802e-06,
      "loss": 0.1259,
      "mae_dtheta": 0.005513328593224287,
      "mae_dx": 0.0012550638057291508,
      "mae_dy": 0.0010638732928782701,
      "pose_mae_dtheta": 0.03821460157632828,
      "pose_mae_dx": 0.01086763758212328,
      "pose_mae_dy": 0.01339619792997837,
      "pose_rmse_dtheta": 0.11864975094795227,
      "pose_rmse_dx": 0.03148750588297844,
      "pose_rmse_dy": 0.04256805032491684,
      "pose_rmse_mean": 0.06423510611057281,
      "rmse_dtheta": 0.016282962635159492,
      "rmse_dx": 0.004907788708806038,
      "rmse_dy": 0.0030689986888319254,
      "rmse_mean": 0.008086583577096462,
      "rotation_flip": 0.0012091898825019598,
      "sparse_tokens": 32089.0,
      "step": 3418,
      "turn_loss": 0.041911277920007706,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.15884593941646535,
      "grad_norm": 0.4886406660079956,
      "learning_rate": 8.215963356068139e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.03372980281710625,
      "mae_dx": 0.012478874064981937,
      "mae_dy": 0.002053948352113366,
      "pose_mae_dtheta": 0.28473061323165894,
      "pose_mae_dx": 0.10582123696804047,
      "pose_mae_dy": 0.02093634195625782,
      "pose_rmse_dtheta": 0.5587905049324036,
      "pose_rmse_dx": 0.2722001373767853,
      "pose_rmse_dy": 0.04472004994750023,
      "pose_rmse_mean": 0.2919035851955414,
      "rmse_dtheta": 0.05678967013955116,
      "rmse_dx": 0.02745772898197174,
      "rmse_dy": 0.003880914766341448,
      "rmse_mean": 0.029376104474067688,
      "rotation_flip": 0.020618556067347527,
      "sparse_tokens": 7820.0,
      "step": 3419,
      "turn_loss": 0.21951361000537872,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.15889239918230813,
      "grad_norm": 0.4687173366546631,
      "learning_rate": 8.214950814662037e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.010507029481232166,
      "mae_dx": 0.0014055827632546425,
      "mae_dy": 0.0025754321832209826,
      "pose_mae_dtheta": 0.07110155373811722,
      "pose_mae_dx": 0.025722647085785866,
      "pose_mae_dy": 0.03331458568572998,
      "pose_rmse_dtheta": 0.1503959447145462,
      "pose_rmse_dx": 0.06051238253712654,
      "pose_rmse_dy": 0.06775297224521637,
      "pose_rmse_mean": 0.09288710355758667,
      "rmse_dtheta": 0.021433664485812187,
      "rmse_dx": 0.00364068360067904,
      "rmse_dy": 0.0047620744444429874,
      "rmse_mean": 0.009945474565029144,
      "rotation_flip": 0.0017863522516563535,
      "sparse_tokens": 32089.0,
      "step": 3420,
      "turn_loss": 0.07605227082967758,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1589388589481509,
      "grad_norm": 0.43993717432022095,
      "learning_rate": 8.213938048432697e-06,
      "loss": 0.1548,
      "mae_dtheta": 0.013330738060176373,
      "mae_dx": 0.0029940595850348473,
      "mae_dy": 0.004410703666508198,
      "pose_mae_dtheta": 0.09571229666471481,
      "pose_mae_dx": 0.03483061492443085,
      "pose_mae_dy": 0.04355872794985771,
      "pose_rmse_dtheta": 0.22363674640655518,
      "pose_rmse_dx": 0.09536132216453552,
      "pose_rmse_dy": 0.1071232333779335,
      "pose_rmse_mean": 0.1420404314994812,
      "rmse_dtheta": 0.02638953924179077,
      "rmse_dx": 0.008438528515398502,
      "rmse_dy": 0.01008625328540802,
      "rmse_mean": 0.01497144065797329,
      "rotation_flip": 0.005962239112704992,
      "sparse_tokens": 32137.0,
      "step": 3421,
      "turn_loss": 0.1253974735736847,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15898531871399368,
      "grad_norm": 0.7531936764717102,
      "learning_rate": 8.212925057450945e-06,
      "loss": 0.0963,
      "mae_dtheta": 0.012996363453567028,
      "mae_dx": 0.002502933843061328,
      "mae_dy": 0.0019664715509861708,
      "pose_mae_dtheta": 0.0980982780456543,
      "pose_mae_dx": 0.024696001783013344,
      "pose_mae_dy": 0.02501477114856243,
      "pose_rmse_dtheta": 0.2710994482040405,
      "pose_rmse_dx": 0.08129128813743591,
      "pose_rmse_dy": 0.06337068974971771,
      "pose_rmse_mean": 0.13858714699745178,
      "rmse_dtheta": 0.03170303255319595,
      "rmse_dx": 0.008226538076996803,
      "rmse_dy": 0.006361923646181822,
      "rmse_mean": 0.01543049793690443,
      "rotation_flip": 0.004050632938742638,
      "sparse_tokens": 32121.0,
      "step": 3422,
      "turn_loss": 0.09395086020231247,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.15903177847983646,
      "grad_norm": 0.3544369041919708,
      "learning_rate": 8.21191184178762e-06,
      "loss": 0.1154,
      "mae_dtheta": 0.007273271679878235,
      "mae_dx": 0.0012019590940326452,
      "mae_dy": 0.001896396977826953,
      "pose_mae_dtheta": 0.04976749047636986,
      "pose_mae_dx": 0.019357211887836456,
      "pose_mae_dy": 0.025728199630975723,
      "pose_rmse_dtheta": 0.09840857982635498,
      "pose_rmse_dx": 0.04587383195757866,
      "pose_rmse_dy": 0.058029238134622574,
      "pose_rmse_mean": 0.06743721663951874,
      "rmse_dtheta": 0.014973633922636509,
      "rmse_dx": 0.003175583900883794,
      "rmse_dy": 0.0037465093191713095,
      "rmse_mean": 0.007298575714230537,
      "rotation_flip": 0.004197271540760994,
      "sparse_tokens": 32137.0,
      "step": 3423,
      "turn_loss": 0.055564794689416885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.15907823824567924,
      "grad_norm": 0.4263610243797302,
      "learning_rate": 8.210898401513574e-06,
      "loss": 0.0725,
      "mae_dtheta": 0.007993045262992382,
      "mae_dx": 0.0017036569770425558,
      "mae_dy": 0.0012132975971326232,
      "pose_mae_dtheta": 0.055347640067338943,
      "pose_mae_dx": 0.01738908141851425,
      "pose_mae_dy": 0.02001277171075344,
      "pose_rmse_dtheta": 0.17658589780330658,
      "pose_rmse_dx": 0.07376956939697266,
      "pose_rmse_dy": 0.05564069375395775,
      "pose_rmse_mean": 0.10199873149394989,
      "rmse_dtheta": 0.021924039348959923,
      "rmse_dx": 0.007141883485019207,
      "rmse_dy": 0.002955446019768715,
      "rmse_mean": 0.01067378930747509,
      "rotation_flip": 0.003775959834456444,
      "sparse_tokens": 32057.0,
      "step": 3424,
      "turn_loss": 0.059134285897016525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.15912469801152201,
      "grad_norm": 0.8626834750175476,
      "learning_rate": 8.209884736699681e-06,
      "loss": 0.2333,
      "mae_dtheta": 0.03557479754090309,
      "mae_dx": 0.016669653356075287,
      "mae_dy": 0.0057944790460169315,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8626834750175476,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 140.2977294921875,
      "model/head/act_norm_mean": 109.527880859375,
      "model/head/act_norm_min": 73.2583236694336,
      "model/head/act_over_embed": 75.2685851427388,
      "model/head/grad_frac": 0.10443834215402603,
      "model/head/grad_norm": 0.09009723365306854,
      "model/head/grad_zero_frac": 0.0001649813202675432,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7016357421875,
      "model/head/update_ratio": 0.0015520032029598951,
      "model/head/weight_delta": 6.888003826141357,
      "model/head/weight_delta_rel": 0.12083598971366882,
      "model/head/weight_norm": 58.052223205566406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.416622519493103,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.416622519493103,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.416622519493103,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.286306895877141,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07398933917284012,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06382937729358673,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0020693677943199873,
      "model/modality_embedder.encoders.pose/weight_delta": 2.254446029663086,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07365977764129639,
      "model/modality_embedder.encoders.pose/weight_norm": 30.844867706298828,
      "model/modality_embedder/grad_frac": 0.07398933917284012,
      "model/modality_embedder/grad_norm": 0.06382937729358673,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0020693677943199873,
      "model/modality_embedder/weight_delta": 2.254446029663086,
      "model/modality_embedder/weight_delta_rel": 0.07365977764129639,
      "model/modality_embedder/weight_norm": 30.844867706298828,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.24976348876953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.44815383184524,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.043333053588867,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.113790838318895,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06819666922092438,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05883214250206947,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002123115584254265,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.5547982454299927,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.056657787412405014,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.71028709411621,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 80.09517669677734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.326174975198413,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.734421730041504,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.717175188194652,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06606834381818771,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.056996069848537445,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019419228192418814,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.9635027647018433,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06801726669073105,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.350326538085938,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 82.27606964111328,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.939701140873016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.33584213256836,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.8260054753162,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06981432437896729,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.060227666050195694,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001987854251638055,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.1048836708068848,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07067805528640747,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.297828674316406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.11116027832031,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.86320064484127,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.371408462524414,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.147852342529266,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06392577290534973,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05514770746231079,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018610752886161208,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.7968337535858154,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06140724942088127,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.632173538208008,
      "model/normalizer/grad_frac": 0.23180431127548218,
      "model/normalizer/grad_norm": 0.19997374713420868,
      "model/normalizer/grad_zero_frac": 0.00022098507906775922,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002557614119723439,
      "model/normalizer/weight_delta": 3.820239543914795,
      "model/normalizer/weight_delta_rel": 0.04920247197151184,
      "model/normalizer/weight_norm": 78.18761444091797,
      "pose_mae_dtheta": 0.3056866526603699,
      "pose_mae_dx": 0.11769063770771027,
      "pose_mae_dy": 0.09666290879249573,
      "pose_rmse_dtheta": 0.4881500005722046,
      "pose_rmse_dx": 0.23671342432498932,
      "pose_rmse_dy": 0.1777542680501938,
      "pose_rmse_mean": 0.3008725643157959,
      "rmse_dtheta": 0.050418879836797714,
      "rmse_dx": 0.030493784695863724,
      "rmse_dy": 0.009355440735816956,
      "rmse_mean": 0.030089369043707848,
      "rotation_flip": 0.00538599630817771,
      "sparse_tokens": 9889.0,
      "step": 3425,
      "turn_loss": 0.2818332314491272,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.1591711577773648,
      "grad_norm": 0.5256632566452026,
      "learning_rate": 8.208870847416824e-06,
      "loss": 0.1836,
      "mae_dtheta": 0.034871168434619904,
      "mae_dx": 0.013822074048221111,
      "mae_dy": 0.00668141758069396,
      "pose_mae_dtheta": 0.2546022832393646,
      "pose_mae_dx": 0.10566388815641403,
      "pose_mae_dy": 0.07408948242664337,
      "pose_rmse_dtheta": 0.4464404582977295,
      "pose_rmse_dx": 0.2098126858472824,
      "pose_rmse_dy": 0.17032675445079803,
      "pose_rmse_mean": 0.27552664279937744,
      "rmse_dtheta": 0.053844574838876724,
      "rmse_dx": 0.025035003200173378,
      "rmse_dy": 0.01404302567243576,
      "rmse_mean": 0.03097420185804367,
      "rotation_flip": 0.011037527583539486,
      "sparse_tokens": 15719.0,
      "step": 3426,
      "turn_loss": 0.29570406675338745,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 11990.0,
      "epoch": 0.1592176175432076,
      "grad_norm": 0.6269605159759521,
      "learning_rate": 8.207856733735908e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.01975831761956215,
      "mae_dx": 0.011234460398554802,
      "mae_dy": 0.003363831900060177,
      "pose_mae_dtheta": 0.1694309264421463,
      "pose_mae_dx": 0.09767606109380722,
      "pose_mae_dy": 0.03790176659822464,
      "pose_rmse_dtheta": 0.3097896873950958,
      "pose_rmse_dx": 0.2575403153896332,
      "pose_rmse_dy": 0.09587462991476059,
      "pose_rmse_mean": 0.22106820344924927,
      "rmse_dtheta": 0.03353411704301834,
      "rmse_dx": 0.02500339411199093,
      "rmse_dy": 0.006561380345374346,
      "rmse_mean": 0.021699633449316025,
      "rotation_flip": 0.014760147780179977,
      "sparse_tokens": 9042.0,
      "step": 3427,
      "turn_loss": 0.1613222360610962,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15926407730905037,
      "grad_norm": 0.40117913484573364,
      "learning_rate": 8.206842395727847e-06,
      "loss": 0.0829,
      "mae_dtheta": 0.011085151694715023,
      "mae_dx": 0.001982063055038452,
      "mae_dy": 0.002914248965680599,
      "pose_mae_dtheta": 0.08091405779123306,
      "pose_mae_dx": 0.027019334957003593,
      "pose_mae_dy": 0.03209596872329712,
      "pose_rmse_dtheta": 0.18973970413208008,
      "pose_rmse_dx": 0.07071401178836823,
      "pose_rmse_dy": 0.07126893848180771,
      "pose_rmse_mean": 0.11057421565055847,
      "rmse_dtheta": 0.02323622815310955,
      "rmse_dx": 0.005575362592935562,
      "rmse_dy": 0.006566883996129036,
      "rmse_mean": 0.011792825534939766,
      "rotation_flip": 0.005990265868604183,
      "sparse_tokens": 32121.0,
      "step": 3428,
      "turn_loss": 0.08788739144802094,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15931053707489315,
      "grad_norm": 0.45194530487060547,
      "learning_rate": 8.205827833463579e-06,
      "loss": 0.1269,
      "mae_dtheta": 0.014334334060549736,
      "mae_dx": 0.0022088498808443546,
      "mae_dy": 0.0040329862385988235,
      "pose_mae_dtheta": 0.10180556029081345,
      "pose_mae_dx": 0.03779665753245354,
      "pose_mae_dy": 0.04400438442826271,
      "pose_rmse_dtheta": 0.20182479918003082,
      "pose_rmse_dx": 0.09231454133987427,
      "pose_rmse_dy": 0.10970066487789154,
      "pose_rmse_mean": 0.13461333513259888,
      "rmse_dtheta": 0.026381786912679672,
      "rmse_dx": 0.005770951043814421,
      "rmse_dy": 0.008428511209785938,
      "rmse_mean": 0.013527083210647106,
      "rotation_flip": 0.00907029490917921,
      "sparse_tokens": 32121.0,
      "step": 3429,
      "turn_loss": 0.10066427290439606,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.15935699684073593,
      "grad_norm": 0.44752809405326843,
      "learning_rate": 8.204813047014049e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.012149227783083916,
      "mae_dx": 0.0019286575261503458,
      "mae_dy": 0.003269783454015851,
      "pose_mae_dtheta": 0.08368527144193649,
      "pose_mae_dx": 0.027660632506012917,
      "pose_mae_dy": 0.03921399638056755,
      "pose_rmse_dtheta": 0.20614580810070038,
      "pose_rmse_dx": 0.07179093360900879,
      "pose_rmse_dy": 0.11058790981769562,
      "pose_rmse_mean": 0.12950822710990906,
      "rmse_dtheta": 0.025345105677843094,
      "rmse_dx": 0.005084401927888393,
      "rmse_dy": 0.007391186431050301,
      "rmse_mean": 0.012606899254024029,
      "rotation_flip": 0.007377048954367638,
      "sparse_tokens": 32073.0,
      "step": 3430,
      "turn_loss": 0.09529274702072144,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1594034566065787,
      "grad_norm": 0.4320860207080841,
      "learning_rate": 8.203798036450222e-06,
      "loss": 0.108,
      "mae_dtheta": 0.012415755540132523,
      "mae_dx": 0.001955675194039941,
      "mae_dy": 0.002509077312424779,
      "pose_mae_dtheta": 0.08912450075149536,
      "pose_mae_dx": 0.022105582058429718,
      "pose_mae_dy": 0.030521566048264503,
      "pose_rmse_dtheta": 0.25679200887680054,
      "pose_rmse_dx": 0.06601996719837189,
      "pose_rmse_dy": 0.09421651065349579,
      "pose_rmse_mean": 0.1390095055103302,
      "rmse_dtheta": 0.02968841791152954,
      "rmse_dx": 0.006395846605300903,
      "rmse_dy": 0.007671274244785309,
      "rmse_mean": 0.014585180208086967,
      "rotation_flip": 0.006236080080270767,
      "sparse_tokens": 32089.0,
      "step": 3431,
      "turn_loss": 0.09964128583669662,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.15944991637242148,
      "grad_norm": 0.556479275226593,
      "learning_rate": 8.202782801843077e-06,
      "loss": 0.1517,
      "mae_dtheta": 0.028653617948293686,
      "mae_dx": 0.012033045291900635,
      "mae_dy": 0.004097865894436836,
      "pose_mae_dtheta": 0.2410275936126709,
      "pose_mae_dx": 0.09934738278388977,
      "pose_mae_dy": 0.04927593842148781,
      "pose_rmse_dtheta": 0.4456377327442169,
      "pose_rmse_dx": 0.23109596967697144,
      "pose_rmse_dy": 0.11171459406614304,
      "pose_rmse_mean": 0.2628161311149597,
      "rmse_dtheta": 0.04601800814270973,
      "rmse_dx": 0.02552856132388115,
      "rmse_dy": 0.007725033443421125,
      "rmse_mean": 0.026423867791891098,
      "rotation_flip": 0.007259528152644634,
      "sparse_tokens": 12577.0,
      "step": 3432,
      "turn_loss": 0.17357049882411957,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.15949637613826426,
      "grad_norm": 0.4026930630207062,
      "learning_rate": 8.201767343263612e-06,
      "loss": 0.1342,
      "mae_dtheta": 0.0051675960421562195,
      "mae_dx": 0.0014288233360275626,
      "mae_dy": 0.0009032362722791731,
      "pose_mae_dtheta": 0.03939908742904663,
      "pose_mae_dx": 0.013252457603812218,
      "pose_mae_dy": 0.011525715701282024,
      "pose_rmse_dtheta": 0.13931849598884583,
      "pose_rmse_dx": 0.038389671593904495,
      "pose_rmse_dy": 0.03378459811210632,
      "pose_rmse_mean": 0.07049758732318878,
      "rmse_dtheta": 0.017717884853482246,
      "rmse_dx": 0.004641411360353231,
      "rmse_dy": 0.0026705285999923944,
      "rmse_mean": 0.008343275636434555,
      "rotation_flip": 0.004055149853229523,
      "sparse_tokens": 32105.0,
      "step": 3433,
      "turn_loss": 0.04207584261894226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.15954283590410703,
      "grad_norm": 1.0601897239685059,
      "learning_rate": 8.20075166078284e-06,
      "loss": 0.2317,
      "mae_dtheta": 0.035120896995067596,
      "mae_dx": 0.010422509163618088,
      "mae_dy": 0.00488392123952508,
      "pose_mae_dtheta": 0.26718541979789734,
      "pose_mae_dx": 0.0777052491903305,
      "pose_mae_dy": 0.06953701376914978,
      "pose_rmse_dtheta": 0.49615782499313354,
      "pose_rmse_dx": 0.18714334070682526,
      "pose_rmse_dy": 0.15564420819282532,
      "pose_rmse_mean": 0.27964848279953003,
      "rmse_dtheta": 0.05363403260707855,
      "rmse_dx": 0.023035803809762,
      "rmse_dy": 0.010156641714274883,
      "rmse_mean": 0.028942158445715904,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 10832.0,
      "step": 3434,
      "turn_loss": 0.26844847202301025,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1595892956699498,
      "grad_norm": 0.43370646238327026,
      "learning_rate": 8.199735754471785e-06,
      "loss": 0.1248,
      "mae_dtheta": 0.005419169552624226,
      "mae_dx": 0.0014499829849228263,
      "mae_dy": 0.0009683087118901312,
      "pose_mae_dtheta": 0.03817081078886986,
      "pose_mae_dx": 0.012872915714979172,
      "pose_mae_dy": 0.011830111965537071,
      "pose_rmse_dtheta": 0.13275687396526337,
      "pose_rmse_dx": 0.02849242277443409,
      "pose_rmse_dy": 0.028789499774575233,
      "pose_rmse_mean": 0.063346266746521,
      "rmse_dtheta": 0.015766087919473648,
      "rmse_dx": 0.004011398646980524,
      "rmse_dy": 0.002224863739684224,
      "rmse_mean": 0.007334116846323013,
      "rotation_flip": 0.0019011406693607569,
      "sparse_tokens": 32169.0,
      "step": 3435,
      "turn_loss": 0.04403514042496681,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.15963575543579261,
      "grad_norm": 0.4151955246925354,
      "learning_rate": 8.198719624401493e-06,
      "loss": 0.0773,
      "mae_dtheta": 0.007965108379721642,
      "mae_dx": 0.002146167680621147,
      "mae_dy": 0.001721264561638236,
      "pose_mae_dtheta": 0.060737285763025284,
      "pose_mae_dx": 0.01965656317770481,
      "pose_mae_dy": 0.02285648323595524,
      "pose_rmse_dtheta": 0.16655471920967102,
      "pose_rmse_dx": 0.06743613630533218,
      "pose_rmse_dy": 0.06967674195766449,
      "pose_rmse_mean": 0.10122253745794296,
      "rmse_dtheta": 0.021305788308382034,
      "rmse_dx": 0.007212798576802015,
      "rmse_dy": 0.0046457936987280846,
      "rmse_mean": 0.011054794304072857,
      "rotation_flip": 0.0041806017979979515,
      "sparse_tokens": 32137.0,
      "step": 3436,
      "turn_loss": 0.07490277290344238,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1596822152016354,
      "grad_norm": 0.6154330968856812,
      "learning_rate": 8.197703270643018e-06,
      "loss": 0.1371,
      "mae_dtheta": 0.00867457129061222,
      "mae_dx": 0.0012592112179845572,
      "mae_dy": 0.001393259852193296,
      "pose_mae_dtheta": 0.06130383536219597,
      "pose_mae_dx": 0.014809029176831245,
      "pose_mae_dy": 0.020014688372612,
      "pose_rmse_dtheta": 0.1839388757944107,
      "pose_rmse_dx": 0.04448862373828888,
      "pose_rmse_dy": 0.04767666384577751,
      "pose_rmse_mean": 0.0920347198843956,
      "rmse_dtheta": 0.021773286163806915,
      "rmse_dx": 0.004173623397946358,
      "rmse_dy": 0.0030047886539250612,
      "rmse_mean": 0.00965056661516428,
      "rotation_flip": 0.006275212857872248,
      "sparse_tokens": 32105.0,
      "step": 3437,
      "turn_loss": 0.05971819907426834,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7491.0,
      "epoch": 0.15972867496747817,
      "grad_norm": 0.7971246838569641,
      "learning_rate": 8.19668669326744e-06,
      "loss": 0.2692,
      "mae_dtheta": 0.03356638550758362,
      "mae_dx": 0.014384390786290169,
      "mae_dy": 0.005493365228176117,
      "pose_mae_dtheta": 0.2686096429824829,
      "pose_mae_dx": 0.13993574678897858,
      "pose_mae_dy": 0.06666599214076996,
      "pose_rmse_dtheta": 0.4429216682910919,
      "pose_rmse_dx": 0.28429073095321655,
      "pose_rmse_dy": 0.16706597805023193,
      "pose_rmse_mean": 0.2980928122997284,
      "rmse_dtheta": 0.04911475628614426,
      "rmse_dx": 0.028229964897036552,
      "rmse_dy": 0.010860300622880459,
      "rmse_mean": 0.02940167486667633,
      "rotation_flip": 0.013297872617840767,
      "sparse_tokens": 5944.0,
      "step": 3438,
      "turn_loss": 0.24263960123062134,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.15977513473332094,
      "grad_norm": 0.5845191478729248,
      "learning_rate": 8.195669892345842e-06,
      "loss": 0.1563,
      "mae_dtheta": 0.041838131844997406,
      "mae_dx": 0.010201238095760345,
      "mae_dy": 0.004432312212884426,
      "pose_mae_dtheta": 0.34154289960861206,
      "pose_mae_dx": 0.07780703157186508,
      "pose_mae_dy": 0.05569323152303696,
      "pose_rmse_dtheta": 0.5488030910491943,
      "pose_rmse_dx": 0.1649521142244339,
      "pose_rmse_dy": 0.14454475045204163,
      "pose_rmse_mean": 0.28610000014305115,
      "rmse_dtheta": 0.06040636822581291,
      "rmse_dx": 0.021197933703660965,
      "rmse_dy": 0.010553852654993534,
      "rmse_mean": 0.03071938455104828,
      "rotation_flip": 0.021159153431653976,
      "sparse_tokens": 16721.0,
      "step": 3439,
      "turn_loss": 0.32847660779953003,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.15982159449916372,
      "grad_norm": 0.6800459027290344,
      "learning_rate": 8.194652867949338e-06,
      "loss": 0.1825,
      "mae_dtheta": 0.028210802003741264,
      "mae_dx": 0.013676116243004799,
      "mae_dy": 0.005367578938603401,
      "pose_mae_dtheta": 0.2231271117925644,
      "pose_mae_dx": 0.11930301040410995,
      "pose_mae_dy": 0.073356494307518,
      "pose_rmse_dtheta": 0.39511972665786743,
      "pose_rmse_dx": 0.2810639441013336,
      "pose_rmse_dy": 0.17410026490688324,
      "pose_rmse_mean": 0.28342801332473755,
      "rmse_dtheta": 0.0436224602162838,
      "rmse_dx": 0.02822355553507805,
      "rmse_dy": 0.010297778062522411,
      "rmse_mean": 0.02738126367330551,
      "rotation_flip": 0.018779342994093895,
      "sparse_tokens": 16826.0,
      "step": 3440,
      "turn_loss": 0.255105584859848,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1598680542650065,
      "grad_norm": 0.39981815218925476,
      "learning_rate": 8.193635620149041e-06,
      "loss": 0.1244,
      "mae_dtheta": 0.008383557200431824,
      "mae_dx": 0.0024880869314074516,
      "mae_dy": 0.0029040633235126734,
      "pose_mae_dtheta": 0.061825305223464966,
      "pose_mae_dx": 0.03156547248363495,
      "pose_mae_dy": 0.02744900807738304,
      "pose_rmse_dtheta": 0.15633238852024078,
      "pose_rmse_dx": 0.0846874862909317,
      "pose_rmse_dy": 0.06582485139369965,
      "pose_rmse_mean": 0.10228157043457031,
      "rmse_dtheta": 0.01930088922381401,
      "rmse_dx": 0.00686334865167737,
      "rmse_dy": 0.0068363104946911335,
      "rmse_mean": 0.01100018247961998,
      "rotation_flip": 0.001325088320299983,
      "sparse_tokens": 32073.0,
      "step": 3441,
      "turn_loss": 0.08204685896635056,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.15991451403084928,
      "grad_norm": 0.5913041234016418,
      "learning_rate": 8.192618149016092e-06,
      "loss": 0.155,
      "mae_dtheta": 0.02977583184838295,
      "mae_dx": 0.0181508157402277,
      "mae_dy": 0.009387015365064144,
      "pose_mae_dtheta": 0.23605675995349884,
      "pose_mae_dx": 0.11637448519468307,
      "pose_mae_dy": 0.11526820063591003,
      "pose_rmse_dtheta": 0.37002792954444885,
      "pose_rmse_dx": 0.2410043329000473,
      "pose_rmse_dy": 0.23040777444839478,
      "pose_rmse_mean": 0.2804800271987915,
      "rmse_dtheta": 0.041266269981861115,
      "rmse_dx": 0.03224210813641548,
      "rmse_dy": 0.016276678070425987,
      "rmse_mean": 0.029928354546427727,
      "rotation_flip": 0.013215859420597553,
      "sparse_tokens": 8138.0,
      "step": 3442,
      "turn_loss": 0.28008174896240234,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.15996097379669205,
      "grad_norm": 0.6291763782501221,
      "learning_rate": 8.191600454621642e-06,
      "loss": 0.1791,
      "mae_dtheta": 0.012479441240429878,
      "mae_dx": 0.0019904007203876972,
      "mae_dy": 0.003582027042284608,
      "pose_mae_dtheta": 0.08763406425714493,
      "pose_mae_dx": 0.0320880152285099,
      "pose_mae_dy": 0.039941925555467606,
      "pose_rmse_dtheta": 0.21501140296459198,
      "pose_rmse_dx": 0.07554329186677933,
      "pose_rmse_dy": 0.10576052963733673,
      "pose_rmse_mean": 0.13210508227348328,
      "rmse_dtheta": 0.025491276755928993,
      "rmse_dx": 0.005025883670896292,
      "rmse_dy": 0.0077429115772247314,
      "rmse_mean": 0.012753358110785484,
      "rotation_flip": 0.006520247086882591,
      "sparse_tokens": 32121.0,
      "step": 3443,
      "turn_loss": 0.10154624283313751,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.16000743356253486,
      "grad_norm": 0.5550192594528198,
      "learning_rate": 8.190582537036859e-06,
      "loss": 0.1883,
      "mae_dtheta": 0.03728114813566208,
      "mae_dx": 0.007105254102498293,
      "mae_dy": 0.00600100215524435,
      "pose_mae_dtheta": 0.2956128716468811,
      "pose_mae_dx": 0.07497688382863998,
      "pose_mae_dy": 0.09181492030620575,
      "pose_rmse_dtheta": 0.5075290203094482,
      "pose_rmse_dx": 0.1528487354516983,
      "pose_rmse_dy": 0.2674320638179779,
      "pose_rmse_mean": 0.3092699646949768,
      "rmse_dtheta": 0.05550136789679527,
      "rmse_dx": 0.016166115179657936,
      "rmse_dy": 0.01401553489267826,
      "rmse_mean": 0.028561007231473923,
      "rotation_flip": 0.014641288667917252,
      "sparse_tokens": 11975.0,
      "step": 3444,
      "turn_loss": 0.2484186738729477,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.16005389332837763,
      "grad_norm": 0.47716495394706726,
      "learning_rate": 8.189564396332927e-06,
      "loss": 0.11,
      "mae_dtheta": 0.042233340442180634,
      "mae_dx": 0.008219177834689617,
      "mae_dy": 0.00635366328060627,
      "pose_mae_dtheta": 0.359799325466156,
      "pose_mae_dx": 0.05978746339678764,
      "pose_mae_dy": 0.06998607516288757,
      "pose_rmse_dtheta": 0.6431332230567932,
      "pose_rmse_dx": 0.1317111849784851,
      "pose_rmse_dy": 0.13192428648471832,
      "pose_rmse_mean": 0.3022562265396118,
      "rmse_dtheta": 0.06353335827589035,
      "rmse_dx": 0.01879873126745224,
      "rmse_dy": 0.010886751115322113,
      "rmse_mean": 0.031072948127985,
      "rotation_flip": 0.009523809887468815,
      "sparse_tokens": 6365.0,
      "step": 3445,
      "turn_loss": 0.3047308623790741,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1601003530942204,
      "grad_norm": 0.5884557366371155,
      "learning_rate": 8.188546032581043e-06,
      "loss": 0.1893,
      "mae_dtheta": 0.019827673211693764,
      "mae_dx": 0.0036520452704280615,
      "mae_dy": 0.006090831942856312,
      "pose_mae_dtheta": 0.14381885528564453,
      "pose_mae_dx": 0.05429550260305405,
      "pose_mae_dy": 0.057710111141204834,
      "pose_rmse_dtheta": 0.3103172183036804,
      "pose_rmse_dx": 0.1390676647424698,
      "pose_rmse_dy": 0.13814617693424225,
      "pose_rmse_mean": 0.1958436816930771,
      "rmse_dtheta": 0.03594410791993141,
      "rmse_dx": 0.008910841308534145,
      "rmse_dy": 0.012517035938799381,
      "rmse_mean": 0.019123995676636696,
      "rotation_flip": 0.006085192784667015,
      "sparse_tokens": 32073.0,
      "step": 3446,
      "turn_loss": 0.1576804220676422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1601468128600632,
      "grad_norm": 0.835570216178894,
      "learning_rate": 8.187527445852427e-06,
      "loss": 0.1071,
      "mae_dtheta": 0.012261299416422844,
      "mae_dx": 0.0016627374570816755,
      "mae_dy": 0.002997070085257292,
      "pose_mae_dtheta": 0.08384063839912415,
      "pose_mae_dx": 0.030774252489209175,
      "pose_mae_dy": 0.03929780796170235,
      "pose_rmse_dtheta": 0.20775501430034637,
      "pose_rmse_dx": 0.0752994567155838,
      "pose_rmse_dy": 0.0855294018983841,
      "pose_rmse_mean": 0.12286128848791122,
      "rmse_dtheta": 0.024984272196888924,
      "rmse_dx": 0.004399217199534178,
      "rmse_dy": 0.00605578301474452,
      "rmse_mean": 0.011813091114163399,
      "rotation_flip": 0.0023255813866853714,
      "sparse_tokens": 32089.0,
      "step": 3447,
      "turn_loss": 0.10112611204385757,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.16019327262590596,
      "grad_norm": 0.5499401688575745,
      "learning_rate": 8.186508636218304e-06,
      "loss": 0.1506,
      "mae_dtheta": 0.019449507817626,
      "mae_dx": 0.002453763270750642,
      "mae_dy": 0.005017647985368967,
      "pose_mae_dtheta": 0.1388721913099289,
      "pose_mae_dx": 0.044252894818782806,
      "pose_mae_dy": 0.057036757469177246,
      "pose_rmse_dtheta": 0.27965375781059265,
      "pose_rmse_dx": 0.10174933820962906,
      "pose_rmse_dy": 0.1207566112279892,
      "pose_rmse_mean": 0.16738657653331757,
      "rmse_dtheta": 0.0343184731900692,
      "rmse_dx": 0.006798648275434971,
      "rmse_dy": 0.00990593247115612,
      "rmse_mean": 0.01700768433511257,
      "rotation_flip": 0.008925724774599075,
      "sparse_tokens": 32057.0,
      "step": 3448,
      "turn_loss": 0.15687620639801025,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26931.0,
      "epoch": 0.16023973239174874,
      "grad_norm": 0.6584394574165344,
      "learning_rate": 8.185489603749923e-06,
      "loss": 0.1375,
      "mae_dtheta": 0.029485758394002914,
      "mae_dx": 0.009094823151826859,
      "mae_dy": 0.00474153645336628,
      "pose_mae_dtheta": 0.22384922206401825,
      "pose_mae_dx": 0.07448496669530869,
      "pose_mae_dy": 0.062491025775671005,
      "pose_rmse_dtheta": 0.4321427643299103,
      "pose_rmse_dx": 0.1816169023513794,
      "pose_rmse_dy": 0.141250878572464,
      "pose_rmse_mean": 0.2516701817512512,
      "rmse_dtheta": 0.04701174050569534,
      "rmse_dx": 0.021083278581500053,
      "rmse_dy": 0.00836263969540596,
      "rmse_mean": 0.025485888123512268,
      "rotation_flip": 0.015557476319372654,
      "sparse_tokens": 22021.0,
      "step": 3449,
      "turn_loss": 0.2244701087474823,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.16028619215759152,
      "grad_norm": 0.6733561158180237,
      "learning_rate": 8.184470348518542e-06,
      "loss": 0.1288,
      "mae_dtheta": 0.013220757246017456,
      "mae_dx": 0.0042842235416173935,
      "mae_dy": 0.004923747852444649,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6733561158180237,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.60586547851562,
      "model/head/act_norm_mean": 108.11915048926768,
      "model/head/act_norm_min": 61.766056060791016,
      "model/head/act_over_embed": 74.30049244365954,
      "model/head/grad_frac": 0.10165678709745407,
      "model/head/grad_norm": 0.06845121830701828,
      "model/head/grad_zero_frac": 0.0001532422611489892,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6894383285984849,
      "model/head/update_ratio": 0.001178981619887054,
      "model/head/weight_delta": 6.914022922515869,
      "model/head/weight_delta_rel": 0.12129244208335876,
      "model/head/weight_norm": 58.05961227416992,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4166678190231323,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4166031538672713,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4165351092815399,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2862935876377656,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08799581229686737,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05925251916050911,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5395905981759657,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019209211459383368,
      "model/modality_embedder.encoders.pose/weight_delta": 2.2640767097473145,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07397444546222687,
      "model/modality_embedder.encoders.pose/weight_norm": 30.845888137817383,
      "model/modality_embedder/grad_frac": 0.08799581229686737,
      "model/modality_embedder/grad_norm": 0.05925251916050911,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5395905981759657,
      "model/modality_embedder/update_ratio": 0.0019209211459383368,
      "model/modality_embedder/weight_delta": 2.2640767097473145,
      "model/modality_embedder/weight_delta_rel": 0.07397444546222687,
      "model/modality_embedder/weight_norm": 30.845888137817383,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.54655456542969,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.442024410774412,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.064051628112793,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.10957864277448,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08827954530715942,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05944357067346573,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002145075239241123,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.5639756917953491,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.056992217898368835,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.71164894104004,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.01005554199219,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.473750400833733,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.360820770263672,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.818590402314147,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0912603810429573,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06145073473453522,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0020934962667524815,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.974321961402893,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06839205324649811,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.353160858154297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.0601806640625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.415727212602214,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.550712585449219,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.153135048434805,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10202591866254807,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06869977712631226,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0022672340273857117,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.117370128631592,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07109732180833817,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.30113983154297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.74028015136719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.389222081930416,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.31551456451416,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.50933919878721,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11717169731855392,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07889828085899353,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 8.574080129619688e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002662425162270665,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.8073067665100098,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.061765167862176895,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.633991241455078,
      "model/normalizer/grad_frac": 0.42856061458587646,
      "model/normalizer/grad_norm": 0.2885739207267761,
      "model/normalizer/grad_zero_frac": 0.0001477173063904047,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0036906315945088863,
      "model/normalizer/weight_delta": 3.8423497676849365,
      "model/normalizer/weight_delta_rel": 0.049487240612506866,
      "model/normalizer/weight_norm": 78.19093322753906,
      "pose_mae_dtheta": 0.0936851054430008,
      "pose_mae_dx": 0.04401567205786705,
      "pose_mae_dy": 0.04583364352583885,
      "pose_rmse_dtheta": 0.19998925924301147,
      "pose_rmse_dx": 0.11200591921806335,
      "pose_rmse_dy": 0.1045043021440506,
      "pose_rmse_mean": 0.1388331651687622,
      "rmse_dtheta": 0.025940261781215668,
      "rmse_dx": 0.010916679166257381,
      "rmse_dy": 0.011073257774114609,
      "rmse_mean": 0.015976734459400177,
      "rotation_flip": 0.007723304443061352,
      "sparse_tokens": 32185.0,
      "step": 3450,
      "turn_loss": 0.150620698928833,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24338.0,
      "epoch": 0.1603326519234343,
      "grad_norm": 0.5834527611732483,
      "learning_rate": 8.183450870595443e-06,
      "loss": 0.1391,
      "mae_dtheta": 0.026148447766900063,
      "mae_dx": 0.01122413482517004,
      "mae_dy": 0.005138442385941744,
      "pose_mae_dtheta": 0.20169128477573395,
      "pose_mae_dx": 0.08648515492677689,
      "pose_mae_dy": 0.07784678786993027,
      "pose_rmse_dtheta": 0.3675084710121155,
      "pose_rmse_dx": 0.22222182154655457,
      "pose_rmse_dy": 0.17719711363315582,
      "pose_rmse_mean": 0.25564247369766235,
      "rmse_dtheta": 0.042117293924093246,
      "rmse_dx": 0.025682760402560234,
      "rmse_dy": 0.011559720151126385,
      "rmse_mean": 0.026453256607055664,
      "rotation_flip": 0.008196720853447914,
      "sparse_tokens": 18517.0,
      "step": 3451,
      "turn_loss": 0.22485074400901794,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1603791116892771,
      "grad_norm": 0.4885357916355133,
      "learning_rate": 8.182431170051913e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.00734883826225996,
      "mae_dx": 0.0017018158687278628,
      "mae_dy": 0.0005727809621021152,
      "pose_mae_dtheta": 0.05661241337656975,
      "pose_mae_dx": 0.01426724437624216,
      "pose_mae_dy": 0.009291760623455048,
      "pose_rmse_dtheta": 0.21483764052391052,
      "pose_rmse_dx": 0.042540159076452255,
      "pose_rmse_dy": 0.025813637301325798,
      "pose_rmse_mean": 0.0943971499800682,
      "rmse_dtheta": 0.02420436032116413,
      "rmse_dx": 0.005750982090830803,
      "rmse_dy": 0.0013693844666704535,
      "rmse_mean": 0.010441575199365616,
      "rotation_flip": 0.0031496062874794006,
      "sparse_tokens": 32105.0,
      "step": 3452,
      "turn_loss": 0.04103361815214157,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.16042557145511988,
      "grad_norm": 0.46849265694618225,
      "learning_rate": 8.181411246959265e-06,
      "loss": 0.1396,
      "mae_dtheta": 0.029243987053632736,
      "mae_dx": 0.009312251582741737,
      "mae_dy": 0.00407045753672719,
      "pose_mae_dtheta": 0.25251251459121704,
      "pose_mae_dx": 0.07130007445812225,
      "pose_mae_dy": 0.0559486523270607,
      "pose_rmse_dtheta": 0.44351473450660706,
      "pose_rmse_dx": 0.17002150416374207,
      "pose_rmse_dy": 0.14952358603477478,
      "pose_rmse_mean": 0.25435328483581543,
      "rmse_dtheta": 0.04566473141312599,
      "rmse_dx": 0.020280541852116585,
      "rmse_dy": 0.008340349420905113,
      "rmse_mean": 0.024761876091361046,
      "rotation_flip": 0.017447199672460556,
      "sparse_tokens": 21736.0,
      "step": 3453,
      "turn_loss": 0.25201061367988586,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 30494.0,
      "epoch": 0.16047203122096265,
      "grad_norm": 0.5575093030929565,
      "learning_rate": 8.18039110138882e-06,
      "loss": 0.1167,
      "mae_dtheta": 0.031256303191185,
      "mae_dx": 0.011427865363657475,
      "mae_dy": 0.004316030070185661,
      "pose_mae_dtheta": 0.2255210429430008,
      "pose_mae_dx": 0.08761051297187805,
      "pose_mae_dy": 0.047776028513908386,
      "pose_rmse_dtheta": 0.43709394335746765,
      "pose_rmse_dx": 0.20588350296020508,
      "pose_rmse_dy": 0.10273395478725433,
      "pose_rmse_mean": 0.2485704869031906,
      "rmse_dtheta": 0.05029764771461487,
      "rmse_dx": 0.02390512451529503,
      "rmse_dy": 0.009118322283029556,
      "rmse_mean": 0.027773698791861534,
      "rotation_flip": 0.013215859420597553,
      "sparse_tokens": 24094.0,
      "step": 3454,
      "turn_loss": 0.21600857377052307,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.16051849098680543,
      "grad_norm": 0.596904456615448,
      "learning_rate": 8.17937073341192e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.03425896540284157,
      "mae_dx": 0.010076940059661865,
      "mae_dy": 0.004735913127660751,
      "pose_mae_dtheta": 0.2748807370662689,
      "pose_mae_dx": 0.07452165335416794,
      "pose_mae_dy": 0.04290984570980072,
      "pose_rmse_dtheta": 0.44786307215690613,
      "pose_rmse_dx": 0.19486811757087708,
      "pose_rmse_dy": 0.11330748349428177,
      "pose_rmse_mean": 0.2520129084587097,
      "rmse_dtheta": 0.0496363565325737,
      "rmse_dx": 0.021334221586585045,
      "rmse_dy": 0.01196933351457119,
      "rmse_mean": 0.027646638453006744,
      "rotation_flip": 0.014671814627945423,
      "sparse_tokens": 20043.0,
      "step": 3455,
      "turn_loss": 0.27309495210647583,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.1605649507526482,
      "grad_norm": 0.48467597365379333,
      "learning_rate": 8.178350143099916e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.03586455434560776,
      "mae_dx": 0.014765104278922081,
      "mae_dy": 0.005011826287955046,
      "pose_mae_dtheta": 0.2789246439933777,
      "pose_mae_dx": 0.11850956082344055,
      "pose_mae_dy": 0.05203033611178398,
      "pose_rmse_dtheta": 0.4649297297000885,
      "pose_rmse_dx": 0.2599570155143738,
      "pose_rmse_dy": 0.11055752635002136,
      "pose_rmse_mean": 0.27848145365715027,
      "rmse_dtheta": 0.05318615585565567,
      "rmse_dx": 0.02775423973798752,
      "rmse_dy": 0.009396348148584366,
      "rmse_mean": 0.03011224791407585,
      "rotation_flip": 0.013599274680018425,
      "sparse_tokens": 19022.0,
      "step": 3456,
      "turn_loss": 0.31549856066703796,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.16061141051849098,
      "grad_norm": 0.7922720313072205,
      "learning_rate": 8.177329330524182e-06,
      "loss": 0.1978,
      "mae_dtheta": 0.018214302137494087,
      "mae_dx": 0.0034292349591851234,
      "mae_dy": 0.003782199928537011,
      "pose_mae_dtheta": 0.13819174468517303,
      "pose_mae_dx": 0.031156053766608238,
      "pose_mae_dy": 0.038971200585365295,
      "pose_rmse_dtheta": 0.34420275688171387,
      "pose_rmse_dx": 0.07153457403182983,
      "pose_rmse_dy": 0.096863754093647,
      "pose_rmse_mean": 0.17086702585220337,
      "rmse_dtheta": 0.03840639442205429,
      "rmse_dx": 0.009519853629171848,
      "rmse_dy": 0.009681685827672482,
      "rmse_mean": 0.019202645868062973,
      "rotation_flip": 0.009569377638399601,
      "sparse_tokens": 32153.0,
      "step": 3457,
      "turn_loss": 0.1571052223443985,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.16065787028433376,
      "grad_norm": 0.4600384831428528,
      "learning_rate": 8.1763082957561e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.011893372051417828,
      "mae_dx": 0.002029217779636383,
      "mae_dy": 0.0018652433063834906,
      "pose_mae_dtheta": 0.07855652272701263,
      "pose_mae_dx": 0.027680160477757454,
      "pose_mae_dy": 0.028990423306822777,
      "pose_rmse_dtheta": 0.18474121391773224,
      "pose_rmse_dx": 0.08840882778167725,
      "pose_rmse_dy": 0.06799151748418808,
      "pose_rmse_mean": 0.11371385306119919,
      "rmse_dtheta": 0.02381487376987934,
      "rmse_dx": 0.008258619345724583,
      "rmse_dy": 0.0034741018898785114,
      "rmse_mean": 0.01184919849038124,
      "rotation_flip": 0.002039151731878519,
      "sparse_tokens": 32041.0,
      "step": 3458,
      "turn_loss": 0.08463966846466064,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16070433005017654,
      "grad_norm": 0.43068090081214905,
      "learning_rate": 8.175287038867078e-06,
      "loss": 0.1048,
      "mae_dtheta": 0.007161453366279602,
      "mae_dx": 0.0012010438367724419,
      "mae_dy": 0.0007599064847454429,
      "pose_mae_dtheta": 0.05385959520936012,
      "pose_mae_dx": 0.01137093361467123,
      "pose_mae_dy": 0.01360640674829483,
      "pose_rmse_dtheta": 0.21214324235916138,
      "pose_rmse_dx": 0.03526119142770767,
      "pose_rmse_dy": 0.03350899741053581,
      "pose_rmse_mean": 0.09363780915737152,
      "rmse_dtheta": 0.02348265051841736,
      "rmse_dx": 0.004265699535608292,
      "rmse_dy": 0.00200495938770473,
      "rmse_mean": 0.009917769581079483,
      "rotation_flip": 0.000596302910707891,
      "sparse_tokens": 32105.0,
      "step": 3459,
      "turn_loss": 0.04360656440258026,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.16075078981601934,
      "grad_norm": 0.4080188274383545,
      "learning_rate": 8.174265559928528e-06,
      "loss": 0.1182,
      "mae_dtheta": 0.040972400456666946,
      "mae_dx": 0.01376060675829649,
      "mae_dy": 0.004129332955926657,
      "pose_mae_dtheta": 0.3783947229385376,
      "pose_mae_dx": 0.1232670471072197,
      "pose_mae_dy": 0.07201863825321198,
      "pose_rmse_dtheta": 0.5699847340583801,
      "pose_rmse_dx": 0.23970507085323334,
      "pose_rmse_dy": 0.17615041136741638,
      "pose_rmse_mean": 0.32861340045928955,
      "rmse_dtheta": 0.05790599808096886,
      "rmse_dx": 0.025761691853404045,
      "rmse_dy": 0.007560865022242069,
      "rmse_mean": 0.030409518629312515,
      "rotation_flip": 0.018547140061855316,
      "sparse_tokens": 13162.0,
      "step": 3460,
      "turn_loss": 0.291892409324646,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.16079724958186212,
      "grad_norm": 0.5895140767097473,
      "learning_rate": 8.173243859011881e-06,
      "loss": 0.1289,
      "mae_dtheta": 0.012537376955151558,
      "mae_dx": 0.002903023501858115,
      "mae_dy": 0.0050357733853161335,
      "pose_mae_dtheta": 0.08765941113233566,
      "pose_mae_dx": 0.042067792266607285,
      "pose_mae_dy": 0.047931231558322906,
      "pose_rmse_dtheta": 0.16145628690719604,
      "pose_rmse_dx": 0.11287572979927063,
      "pose_rmse_dy": 0.10485751181840897,
      "pose_rmse_mean": 0.12639650702476501,
      "rmse_dtheta": 0.022613825276494026,
      "rmse_dx": 0.006790959741920233,
      "rmse_dy": 0.010067246854305267,
      "rmse_mean": 0.013157344423234463,
      "rotation_flip": 0.008177172392606735,
      "sparse_tokens": 32121.0,
      "step": 3461,
      "turn_loss": 0.1470363736152649,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.1608437093477049,
      "grad_norm": 0.6481090784072876,
      "learning_rate": 8.172221936188591e-06,
      "loss": 0.1434,
      "mae_dtheta": 0.027522537857294083,
      "mae_dx": 0.009950020350515842,
      "mae_dy": 0.004967615008354187,
      "pose_mae_dtheta": 0.20345501601696014,
      "pose_mae_dx": 0.07951531559228897,
      "pose_mae_dy": 0.04640129581093788,
      "pose_rmse_dtheta": 0.3348862826824188,
      "pose_rmse_dx": 0.19434070587158203,
      "pose_rmse_dy": 0.12391160428524017,
      "pose_rmse_mean": 0.2177128791809082,
      "rmse_dtheta": 0.04316548630595207,
      "rmse_dx": 0.021525470539927483,
      "rmse_dy": 0.00964396819472313,
      "rmse_mean": 0.024778306484222412,
      "rotation_flip": 0.01138952188193798,
      "sparse_tokens": 8334.0,
      "step": 3462,
      "turn_loss": 0.23062771558761597,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 13928.0,
      "epoch": 0.16089016911354767,
      "grad_norm": 0.861747145652771,
      "learning_rate": 8.171199791530117e-06,
      "loss": 0.235,
      "mae_dtheta": 0.032535482197999954,
      "mae_dx": 0.012053810060024261,
      "mae_dy": 0.003414295380935073,
      "pose_mae_dtheta": 0.2522270083427429,
      "pose_mae_dx": 0.09106609970331192,
      "pose_mae_dy": 0.0544288270175457,
      "pose_rmse_dtheta": 0.4016619026660919,
      "pose_rmse_dx": 0.20970866084098816,
      "pose_rmse_dy": 0.10906735807657242,
      "pose_rmse_mean": 0.2401459813117981,
      "rmse_dtheta": 0.04761337488889694,
      "rmse_dx": 0.0246842410415411,
      "rmse_dy": 0.005985952448099852,
      "rmse_mean": 0.026094524189829826,
      "rotation_flip": 0.010204081423580647,
      "sparse_tokens": 11396.0,
      "step": 3463,
      "turn_loss": 0.20320287346839905,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.16093662887939045,
      "grad_norm": 0.7043136358261108,
      "learning_rate": 8.170177425107937e-06,
      "loss": 0.1782,
      "mae_dtheta": 0.025312013924121857,
      "mae_dx": 0.013530177995562553,
      "mae_dy": 0.005074242129921913,
      "pose_mae_dtheta": 0.19634945690631866,
      "pose_mae_dx": 0.11457721143960953,
      "pose_mae_dy": 0.06013156846165657,
      "pose_rmse_dtheta": 0.32839152216911316,
      "pose_rmse_dx": 0.24940311908721924,
      "pose_rmse_dy": 0.15502142906188965,
      "pose_rmse_mean": 0.24427203834056854,
      "rmse_dtheta": 0.03943457454442978,
      "rmse_dx": 0.02678019367158413,
      "rmse_dy": 0.009704655967652798,
      "rmse_mean": 0.025306476280093193,
      "rotation_flip": 0.009009009227156639,
      "sparse_tokens": 12898.0,
      "step": 3464,
      "turn_loss": 0.22552986443042755,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.16098308864523322,
      "grad_norm": 0.4039127230644226,
      "learning_rate": 8.16915483699355e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.010624883696436882,
      "mae_dx": 0.0027000021655112505,
      "mae_dy": 0.002000250620767474,
      "pose_mae_dtheta": 0.07876601070165634,
      "pose_mae_dx": 0.025264916941523552,
      "pose_mae_dy": 0.024937190115451813,
      "pose_rmse_dtheta": 0.1985970139503479,
      "pose_rmse_dx": 0.06363267451524734,
      "pose_rmse_dy": 0.06889630109071732,
      "pose_rmse_mean": 0.11037532985210419,
      "rmse_dtheta": 0.024423256516456604,
      "rmse_dx": 0.008172353729605675,
      "rmse_dy": 0.005006260704249144,
      "rmse_mean": 0.012533958069980145,
      "rotation_flip": 0.005466778762638569,
      "sparse_tokens": 32201.0,
      "step": 3465,
      "turn_loss": 0.09558769315481186,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.161029548411076,
      "grad_norm": 0.6676415205001831,
      "learning_rate": 8.168132027258467e-06,
      "loss": 0.0768,
      "mae_dtheta": 0.010833604261279106,
      "mae_dx": 0.0016291479114443064,
      "mae_dy": 0.0023587937466800213,
      "pose_mae_dtheta": 0.07744214683771133,
      "pose_mae_dx": 0.024969596415758133,
      "pose_mae_dy": 0.028520740568637848,
      "pose_rmse_dtheta": 0.21463696658611298,
      "pose_rmse_dx": 0.06467942148447037,
      "pose_rmse_dy": 0.07231267541646957,
      "pose_rmse_mean": 0.11720969527959824,
      "rmse_dtheta": 0.02522585727274418,
      "rmse_dx": 0.004500202834606171,
      "rmse_dy": 0.005295333452522755,
      "rmse_mean": 0.01167379878461361,
      "rotation_flip": 0.0057848053984344006,
      "sparse_tokens": 32121.0,
      "step": 3466,
      "turn_loss": 0.07677798718214035,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.16107600817691878,
      "grad_norm": 0.5988238453865051,
      "learning_rate": 8.16710899597421e-06,
      "loss": 0.1921,
      "mae_dtheta": 0.03664248809218407,
      "mae_dx": 0.0085966307669878,
      "mae_dy": 0.00745066162198782,
      "pose_mae_dtheta": 0.29297634959220886,
      "pose_mae_dx": 0.0802868902683258,
      "pose_mae_dy": 0.10123975574970245,
      "pose_rmse_dtheta": 0.49036478996276855,
      "pose_rmse_dx": 0.1576131284236908,
      "pose_rmse_dy": 0.2489600032567978,
      "pose_rmse_mean": 0.29897934198379517,
      "rmse_dtheta": 0.052089180797338486,
      "rmse_dx": 0.016723129898309708,
      "rmse_dy": 0.01320314034819603,
      "rmse_mean": 0.027338486164808273,
      "rotation_flip": 0.015590200200676918,
      "sparse_tokens": 8048.0,
      "step": 3467,
      "turn_loss": 0.3868813216686249,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.16112246794276155,
      "grad_norm": 0.7283936738967896,
      "learning_rate": 8.166085743212319e-06,
      "loss": 0.1581,
      "mae_dtheta": 0.020912030711770058,
      "mae_dx": 0.0023059167433530092,
      "mae_dy": 0.0028303610160946846,
      "pose_mae_dtheta": 0.14370423555374146,
      "pose_mae_dx": 0.026303736492991447,
      "pose_mae_dy": 0.03765680640935898,
      "pose_rmse_dtheta": 0.2676556408405304,
      "pose_rmse_dx": 0.06334277987480164,
      "pose_rmse_dy": 0.08266819268465042,
      "pose_rmse_mean": 0.13788887858390808,
      "rmse_dtheta": 0.0347573384642601,
      "rmse_dx": 0.007622933946549892,
      "rmse_dy": 0.006350036710500717,
      "rmse_mean": 0.01624343730509281,
      "rotation_flip": 0.01230769231915474,
      "sparse_tokens": 5149.0,
      "step": 3468,
      "turn_loss": 0.151884526014328,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.16116892770860436,
      "grad_norm": 0.7989360690116882,
      "learning_rate": 8.165062269044353e-06,
      "loss": 0.1631,
      "mae_dtheta": 0.011294620111584663,
      "mae_dx": 0.0022068663965910673,
      "mae_dy": 0.003339952789247036,
      "pose_mae_dtheta": 0.07771700620651245,
      "pose_mae_dx": 0.031655579805374146,
      "pose_mae_dy": 0.03741254284977913,
      "pose_rmse_dtheta": 0.1642594039440155,
      "pose_rmse_dx": 0.07501426339149475,
      "pose_rmse_dy": 0.08652415871620178,
      "pose_rmse_mean": 0.10859927535057068,
      "rmse_dtheta": 0.022063862532377243,
      "rmse_dx": 0.0063941217958927155,
      "rmse_dy": 0.0070475684478878975,
      "rmse_mean": 0.011835183948278427,
      "rotation_flip": 0.00696225743740797,
      "sparse_tokens": 32073.0,
      "step": 3469,
      "turn_loss": 0.08826858550310135,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.16121538747444714,
      "grad_norm": 0.7874124646186829,
      "learning_rate": 8.164038573541884e-06,
      "loss": 0.1572,
      "mae_dtheta": 0.026868870481848717,
      "mae_dx": 0.011457233689725399,
      "mae_dy": 0.005114424508064985,
      "pose_mae_dtheta": 0.21392840147018433,
      "pose_mae_dx": 0.1020040512084961,
      "pose_mae_dy": 0.0572962760925293,
      "pose_rmse_dtheta": 0.4074517786502838,
      "pose_rmse_dx": 0.25407686829566956,
      "pose_rmse_dy": 0.13393166661262512,
      "pose_rmse_mean": 0.2651534676551819,
      "rmse_dtheta": 0.04330692067742348,
      "rmse_dx": 0.025442693382501602,
      "rmse_dy": 0.010137024335563183,
      "rmse_mean": 0.02629554644227028,
      "rotation_flip": 0.009720535017549992,
      "sparse_tokens": 17996.0,
      "step": 3470,
      "turn_loss": 0.20690950751304626,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.1612618472402899,
      "grad_norm": 0.5219637751579285,
      "learning_rate": 8.163014656776499e-06,
      "loss": 0.1462,
      "mae_dtheta": 0.03312963619828224,
      "mae_dx": 0.011156011372804642,
      "mae_dy": 0.0035414807498455048,
      "pose_mae_dtheta": 0.27693498134613037,
      "pose_mae_dx": 0.07813605666160583,
      "pose_mae_dy": 0.04882144182920456,
      "pose_rmse_dtheta": 0.47863465547561646,
      "pose_rmse_dx": 0.18300914764404297,
      "pose_rmse_dy": 0.1333763152360916,
      "pose_rmse_mean": 0.2650067210197449,
      "rmse_dtheta": 0.04996602237224579,
      "rmse_dx": 0.02270972542464733,
      "rmse_dy": 0.007226106710731983,
      "rmse_mean": 0.02663395367562771,
      "rotation_flip": 0.006051436997950077,
      "sparse_tokens": 12740.0,
      "step": 3471,
      "turn_loss": 0.2889411151409149,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.1613083070061327,
      "grad_norm": 0.52946937084198,
      "learning_rate": 8.161990518819803e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.024259258061647415,
      "mae_dx": 0.008368460461497307,
      "mae_dy": 0.005086794029921293,
      "pose_mae_dtheta": 0.1765192747116089,
      "pose_mae_dx": 0.07739537209272385,
      "pose_mae_dy": 0.07955533266067505,
      "pose_rmse_dtheta": 0.28545093536376953,
      "pose_rmse_dx": 0.19813686609268188,
      "pose_rmse_dy": 0.143247589468956,
      "pose_rmse_mean": 0.2089451402425766,
      "rmse_dtheta": 0.03570462763309479,
      "rmse_dx": 0.02154316008090973,
      "rmse_dy": 0.008287950418889523,
      "rmse_mean": 0.021845247596502304,
      "rotation_flip": 0.007380073890089989,
      "sparse_tokens": 10578.0,
      "step": 3472,
      "turn_loss": 0.215446338057518,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.16135476677197547,
      "grad_norm": 0.5397111177444458,
      "learning_rate": 8.160966159743411e-06,
      "loss": 0.1134,
      "mae_dtheta": 0.010233578272163868,
      "mae_dx": 0.0019010747782886028,
      "mae_dy": 0.0008146127220243216,
      "pose_mae_dtheta": 0.07087606191635132,
      "pose_mae_dx": 0.017331499606370926,
      "pose_mae_dy": 0.010561696253716946,
      "pose_rmse_dtheta": 0.2615285813808441,
      "pose_rmse_dx": 0.047752756625413895,
      "pose_rmse_dy": 0.035520948469638824,
      "pose_rmse_mean": 0.11493410170078278,
      "rmse_dtheta": 0.03248610347509384,
      "rmse_dx": 0.005976506508886814,
      "rmse_dy": 0.0028998833149671555,
      "rmse_mean": 0.013787498697638512,
      "rotation_flip": 0.000735294132027775,
      "sparse_tokens": 32137.0,
      "step": 3473,
      "turn_loss": 0.08338920772075653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16140122653781824,
      "grad_norm": 0.6359654664993286,
      "learning_rate": 8.159941579618959e-06,
      "loss": 0.148,
      "mae_dtheta": 0.008936555124819279,
      "mae_dx": 0.002171528059989214,
      "mae_dy": 0.0017114400397986174,
      "pose_mae_dtheta": 0.06838575750589371,
      "pose_mae_dx": 0.017300929874181747,
      "pose_mae_dy": 0.01909090019762516,
      "pose_rmse_dtheta": 0.20671170949935913,
      "pose_rmse_dx": 0.04821140691637993,
      "pose_rmse_dy": 0.04577508568763733,
      "pose_rmse_mean": 0.10023273527622223,
      "rmse_dtheta": 0.024558013305068016,
      "rmse_dx": 0.007396133150905371,
      "rmse_dy": 0.005553838796913624,
      "rmse_mean": 0.012502661906182766,
      "rotation_flip": 0.0042372881434857845,
      "sparse_tokens": 32105.0,
      "step": 3474,
      "turn_loss": 0.07971566915512085,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19096.0,
      "epoch": 0.16144768630366102,
      "grad_norm": 0.40715956687927246,
      "learning_rate": 8.158916778518097e-06,
      "loss": 0.0921,
      "mae_dtheta": 0.028974171727895737,
      "mae_dx": 0.01083293091505766,
      "mae_dy": 0.0048164487816393375,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.40715956687927246,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.6329345703125,
      "model/head/act_norm_mean": 107.7447033898305,
      "model/head/act_norm_min": 74.33279418945312,
      "model/head/act_over_embed": 74.04316889129733,
      "model/head/grad_frac": 0.1286734640598297,
      "model/head/grad_norm": 0.052390631288290024,
      "model/head/grad_zero_frac": 0.00014721410116180778,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6916214247881356,
      "model/head/update_ratio": 0.0009022647282108665,
      "model/head/weight_delta": 6.94285249710083,
      "model/head/weight_delta_rel": 0.12179819494485855,
      "model/head/weight_norm": 58.065696716308594,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4166836440563202,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4166836440563202,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4166836440563202,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.286348901249241,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06845206767320633,
      "model/modality_embedder.encoders.pose/grad_norm": 0.027870913967490196,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009034759132191539,
      "model/modality_embedder.encoders.pose/weight_delta": 2.2785592079162598,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0744476318359375,
      "model/modality_embedder.encoders.pose/weight_norm": 30.848541259765625,
      "model/modality_embedder/grad_frac": 0.06845206767320633,
      "model/modality_embedder/grad_norm": 0.027870913967490196,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0009034759132191539,
      "model/modality_embedder/weight_delta": 2.2785592079162598,
      "model/modality_embedder/weight_delta_rel": 0.0744476318359375,
      "model/modality_embedder/weight_norm": 30.848541259765625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.50335693359375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.260530165456014,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.054885864257812,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.98485409821578,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.13101911544799805,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.053345683962106705,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019248827593401074,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.5727252960205078,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.057311058044433594,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.71373176574707,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.00038146972656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.14257759954264,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.737838745117188,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.591005352778293,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.132436141371727,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05392264202237129,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018368674209341407,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.9851535558700562,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06876727193593979,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.355762481689453,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.65216827392578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.821273036050577,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.16655445098877,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.744620572940836,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.13141286373138428,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05350600183010101,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001765636377967894,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.1290249824523926,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07148867100477219,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.304088592529297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.23531341552734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.787645866962603,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.179948806762695,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.09593039181607,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.13143877685070038,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.053516555577516556,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018058138666674495,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.8179112672805786,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.062127579003572464,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.635698318481445,
      "model/normalizer/grad_frac": 0.49505892395973206,
      "model/normalizer/grad_norm": 0.20156797766685486,
      "model/normalizer/grad_zero_frac": 0.00012999122554901987,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0025778014678508043,
      "model/normalizer/weight_delta": 3.8638298511505127,
      "model/normalizer/weight_delta_rel": 0.049763891845941544,
      "model/normalizer/weight_norm": 78.19375610351562,
      "pose_mae_dtheta": 0.2411118596792221,
      "pose_mae_dx": 0.09759355336427689,
      "pose_mae_dy": 0.06272853165864944,
      "pose_rmse_dtheta": 0.4379124939441681,
      "pose_rmse_dx": 0.22788964211940765,
      "pose_rmse_dy": 0.1576286107301712,
      "pose_rmse_mean": 0.27447691559791565,
      "rmse_dtheta": 0.04662710428237915,
      "rmse_dx": 0.023227352648973465,
      "rmse_dy": 0.009562834165990353,
      "rmse_mean": 0.026472430676221848,
      "rotation_flip": 0.007795100100338459,
      "sparse_tokens": 15302.0,
      "step": 3475,
      "turn_loss": 0.2649625539779663,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.1614941460695038,
      "grad_norm": 0.7889057993888855,
      "learning_rate": 8.157891756512488e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.029490986838936806,
      "mae_dx": 0.01800418831408024,
      "mae_dy": 0.006560425739735365,
      "pose_mae_dtheta": 0.23445089161396027,
      "pose_mae_dx": 0.15338148176670074,
      "pose_mae_dy": 0.09089241921901703,
      "pose_rmse_dtheta": 0.3684966564178467,
      "pose_rmse_dx": 0.30341702699661255,
      "pose_rmse_dy": 0.1975589096546173,
      "pose_rmse_mean": 0.2898242175579071,
      "rmse_dtheta": 0.04234671592712402,
      "rmse_dx": 0.03219759836792946,
      "rmse_dy": 0.012097724713385105,
      "rmse_mean": 0.028880678117275238,
      "rotation_flip": 0.004301075357943773,
      "sparse_tokens": 7445.0,
      "step": 3476,
      "turn_loss": 0.35019078850746155,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 35689.0,
      "epoch": 0.1615406058353466,
      "grad_norm": 0.6679359078407288,
      "learning_rate": 8.156866513673815e-06,
      "loss": 0.1547,
      "mae_dtheta": 0.027238665148615837,
      "mae_dx": 0.010029810480773449,
      "mae_dy": 0.005089545622467995,
      "pose_mae_dtheta": 0.20365653932094574,
      "pose_mae_dx": 0.08145904541015625,
      "pose_mae_dy": 0.06363661587238312,
      "pose_rmse_dtheta": 0.36917638778686523,
      "pose_rmse_dx": 0.18952590227127075,
      "pose_rmse_dy": 0.14378170669078827,
      "pose_rmse_mean": 0.2341613471508026,
      "rmse_dtheta": 0.043346989899873734,
      "rmse_dx": 0.022639796137809753,
      "rmse_dy": 0.00968792475759983,
      "rmse_mean": 0.025224901735782623,
      "rotation_flip": 0.009417303837835789,
      "sparse_tokens": 28842.0,
      "step": 3477,
      "turn_loss": 0.23209218680858612,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.16158706560118938,
      "grad_norm": 0.4321646988391876,
      "learning_rate": 8.155841050073772e-06,
      "loss": 0.094,
      "mae_dtheta": 0.010261532850563526,
      "mae_dx": 0.0019281182903796434,
      "mae_dy": 0.0025082691572606564,
      "pose_mae_dtheta": 0.06871581077575684,
      "pose_mae_dx": 0.025620663538575172,
      "pose_mae_dy": 0.0324973464012146,
      "pose_rmse_dtheta": 0.14122256636619568,
      "pose_rmse_dx": 0.06542430818080902,
      "pose_rmse_dy": 0.07548577338457108,
      "pose_rmse_mean": 0.09404422342777252,
      "rmse_dtheta": 0.0198407880961895,
      "rmse_dx": 0.006014778278768063,
      "rmse_dy": 0.0053387600928545,
      "rmse_mean": 0.010398109443485737,
      "rotation_flip": 0.0017927573062479496,
      "sparse_tokens": 32121.0,
      "step": 3478,
      "turn_loss": 0.07996930927038193,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.16163352536703215,
      "grad_norm": 0.6174312829971313,
      "learning_rate": 8.15481536578407e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.038910914212465286,
      "mae_dx": 0.01143980398774147,
      "mae_dy": 0.006819513160735369,
      "pose_mae_dtheta": 0.3112546503543854,
      "pose_mae_dx": 0.09593505412340164,
      "pose_mae_dy": 0.0719451829791069,
      "pose_rmse_dtheta": 0.5527219176292419,
      "pose_rmse_dx": 0.1983220875263214,
      "pose_rmse_dy": 0.12827837467193604,
      "pose_rmse_mean": 0.2931074798107147,
      "rmse_dtheta": 0.058315571397542953,
      "rmse_dx": 0.02370644360780716,
      "rmse_dy": 0.011318155564367771,
      "rmse_mean": 0.031113389879465103,
      "rotation_flip": 0.016949152573943138,
      "sparse_tokens": 6642.0,
      "step": 3479,
      "turn_loss": 0.23639918863773346,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.16167998513287493,
      "grad_norm": 0.7792487740516663,
      "learning_rate": 8.153789460876437e-06,
      "loss": 0.2708,
      "mae_dtheta": 0.04277770221233368,
      "mae_dx": 0.01440314669162035,
      "mae_dy": 0.011364959180355072,
      "pose_mae_dtheta": 0.32456526160240173,
      "pose_mae_dx": 0.11790881305932999,
      "pose_mae_dy": 0.12892591953277588,
      "pose_rmse_dtheta": 0.5657508969306946,
      "pose_rmse_dx": 0.2023835927248001,
      "pose_rmse_dy": 0.3007485866546631,
      "pose_rmse_mean": 0.3562943637371063,
      "rmse_dtheta": 0.061094339936971664,
      "rmse_dx": 0.02492072992026806,
      "rmse_dy": 0.021808980032801628,
      "rmse_mean": 0.03594135120511055,
      "rotation_flip": 0.01715686358511448,
      "sparse_tokens": 6709.0,
      "step": 3480,
      "turn_loss": 0.3954116106033325,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.1617264448987177,
      "grad_norm": 0.5599478483200073,
      "learning_rate": 8.152763335422612e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.01081002876162529,
      "mae_dx": 0.0027289006393402815,
      "mae_dy": 0.0017622709274291992,
      "pose_mae_dtheta": 0.0748395249247551,
      "pose_mae_dx": 0.027271565049886703,
      "pose_mae_dy": 0.020250018686056137,
      "pose_rmse_dtheta": 0.1739644557237625,
      "pose_rmse_dx": 0.06782281398773193,
      "pose_rmse_dy": 0.04672523960471153,
      "pose_rmse_mean": 0.0961708351969719,
      "rmse_dtheta": 0.024762028828263283,
      "rmse_dx": 0.007900569587945938,
      "rmse_dy": 0.003873932408168912,
      "rmse_mean": 0.012178844772279263,
      "rotation_flip": 0.006680584512650967,
      "sparse_tokens": 32201.0,
      "step": 3481,
      "turn_loss": 0.1017613634467125,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 42189.0,
      "epoch": 0.16177290466456049,
      "grad_norm": 0.5378796458244324,
      "learning_rate": 8.151736989494359e-06,
      "loss": 0.144,
      "mae_dtheta": 0.03442489355802536,
      "mae_dx": 0.01134271640330553,
      "mae_dy": 0.004597764927893877,
      "pose_mae_dtheta": 0.27644476294517517,
      "pose_mae_dx": 0.08958417177200317,
      "pose_mae_dy": 0.06001415103673935,
      "pose_rmse_dtheta": 0.47365960478782654,
      "pose_rmse_dx": 0.19141961634159088,
      "pose_rmse_dy": 0.1392267644405365,
      "pose_rmse_mean": 0.2681020200252533,
      "rmse_dtheta": 0.05198892578482628,
      "rmse_dx": 0.02305380254983902,
      "rmse_dy": 0.009280863218009472,
      "rmse_mean": 0.028107862919569016,
      "rotation_flip": 0.009743589907884598,
      "sparse_tokens": 30189.0,
      "step": 3482,
      "turn_loss": 0.2518346309661865,
      "turns": 130.0,
      "turns_per_sample": 130.0
    },
    {
      "dense_tokens": 38495.0,
      "epoch": 0.16181936443040326,
      "grad_norm": 0.778973400592804,
      "learning_rate": 8.150710423163443e-06,
      "loss": 0.2247,
      "mae_dtheta": 0.037137825042009354,
      "mae_dx": 0.013758335262537003,
      "mae_dy": 0.004759174771606922,
      "pose_mae_dtheta": 0.31219470500946045,
      "pose_mae_dx": 0.11305839568376541,
      "pose_mae_dy": 0.05244653299450874,
      "pose_rmse_dtheta": 0.5271442532539368,
      "pose_rmse_dx": 0.24199679493904114,
      "pose_rmse_dy": 0.1313815861940384,
      "pose_rmse_mean": 0.3001742362976074,
      "rmse_dtheta": 0.055485837161540985,
      "rmse_dx": 0.02591480128467083,
      "rmse_dy": 0.010155253112316132,
      "rmse_mean": 0.030518632382154465,
      "rotation_flip": 0.018599562346935272,
      "sparse_tokens": 29641.0,
      "step": 3483,
      "turn_loss": 0.28945446014404297,
      "turns": 119.0,
      "turns_per_sample": 119.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.16186582419624604,
      "grad_norm": 0.5515106320381165,
      "learning_rate": 8.149683636501657e-06,
      "loss": 0.101,
      "mae_dtheta": 0.01074599102139473,
      "mae_dx": 0.002509716432541609,
      "mae_dy": 0.002804981777444482,
      "pose_mae_dtheta": 0.07936826348304749,
      "pose_mae_dx": 0.030865294858813286,
      "pose_mae_dy": 0.03173511475324631,
      "pose_rmse_dtheta": 0.2016943246126175,
      "pose_rmse_dx": 0.08834165334701538,
      "pose_rmse_dy": 0.07769366353750229,
      "pose_rmse_mean": 0.12257654964923859,
      "rmse_dtheta": 0.023501800373196602,
      "rmse_dx": 0.008159779943525791,
      "rmse_dy": 0.006977098528295755,
      "rmse_mean": 0.012879560701549053,
      "rotation_flip": 0.0067810132168233395,
      "sparse_tokens": 32089.0,
      "step": 3484,
      "turn_loss": 0.10121214389801025,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.16191228396208884,
      "grad_norm": 0.7733229398727417,
      "learning_rate": 8.148656629580803e-06,
      "loss": 0.2194,
      "mae_dtheta": 0.030461130663752556,
      "mae_dx": 0.011163071729242802,
      "mae_dy": 0.004359014332294464,
      "pose_mae_dtheta": 0.25810280442237854,
      "pose_mae_dx": 0.08367273211479187,
      "pose_mae_dy": 0.04001510888338089,
      "pose_rmse_dtheta": 0.48496368527412415,
      "pose_rmse_dx": 0.22273151576519012,
      "pose_rmse_dy": 0.09077727049589157,
      "pose_rmse_mean": 0.26615750789642334,
      "rmse_dtheta": 0.04876190051436424,
      "rmse_dx": 0.023992938920855522,
      "rmse_dy": 0.008928857743740082,
      "rmse_mean": 0.027227899059653282,
      "rotation_flip": 0.014326647855341434,
      "sparse_tokens": 6584.0,
      "step": 3485,
      "turn_loss": 0.24359680712223053,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.16195874372793162,
      "grad_norm": 0.4370635449886322,
      "learning_rate": 8.147629402472703e-06,
      "loss": 0.0883,
      "mae_dtheta": 0.008739718236029148,
      "mae_dx": 0.0014819272328168154,
      "mae_dy": 0.0017515714280307293,
      "pose_mae_dtheta": 0.058795370161533356,
      "pose_mae_dx": 0.01846122369170189,
      "pose_mae_dy": 0.02207137830555439,
      "pose_rmse_dtheta": 0.15859806537628174,
      "pose_rmse_dx": 0.052037835121154785,
      "pose_rmse_dy": 0.05796682462096214,
      "pose_rmse_mean": 0.08953424543142319,
      "rmse_dtheta": 0.02148946188390255,
      "rmse_dx": 0.004617694299668074,
      "rmse_dy": 0.004222064279019833,
      "rmse_mean": 0.010109740309417248,
      "rotation_flip": 0.0034313725773245096,
      "sparse_tokens": 32089.0,
      "step": 3486,
      "turn_loss": 0.07017607241868973,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.1620052034937744,
      "grad_norm": 1.2923170328140259,
      "learning_rate": 8.146601955249187e-06,
      "loss": 0.305,
      "mae_dtheta": 0.026708731427788734,
      "mae_dx": 0.014547158032655716,
      "mae_dy": 0.005922890733927488,
      "pose_mae_dtheta": 0.18256878852844238,
      "pose_mae_dx": 0.1146155446767807,
      "pose_mae_dy": 0.07750734686851501,
      "pose_rmse_dtheta": 0.31856536865234375,
      "pose_rmse_dx": 0.2542770206928253,
      "pose_rmse_dy": 0.16526347398757935,
      "pose_rmse_mean": 0.24603527784347534,
      "rmse_dtheta": 0.04245033487677574,
      "rmse_dx": 0.02784740924835205,
      "rmse_dy": 0.010601148940622807,
      "rmse_mean": 0.02696629986166954,
      "rotation_flip": 0.012882447801530361,
      "sparse_tokens": 14199.0,
      "step": 3487,
      "turn_loss": 0.28814971446990967,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16205166325961717,
      "grad_norm": 0.525844395160675,
      "learning_rate": 8.14557428798211e-06,
      "loss": 0.135,
      "mae_dtheta": 0.012569940648972988,
      "mae_dx": 0.0024491650983691216,
      "mae_dy": 0.002771760569885373,
      "pose_mae_dtheta": 0.09219451248645782,
      "pose_mae_dx": 0.026328621432185173,
      "pose_mae_dy": 0.034108251333236694,
      "pose_rmse_dtheta": 0.23298205435276031,
      "pose_rmse_dx": 0.06655947118997574,
      "pose_rmse_dy": 0.07323361933231354,
      "pose_rmse_mean": 0.1242583841085434,
      "rmse_dtheta": 0.027600040659308434,
      "rmse_dx": 0.00852205790579319,
      "rmse_dy": 0.006349644623696804,
      "rmse_mean": 0.01415724866092205,
      "rotation_flip": 0.005818463861942291,
      "sparse_tokens": 32105.0,
      "step": 3488,
      "turn_loss": 0.10236815363168716,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.16209812302545995,
      "grad_norm": 0.5273257493972778,
      "learning_rate": 8.144546400743334e-06,
      "loss": 0.1029,
      "mae_dtheta": 0.037594638764858246,
      "mae_dx": 0.011847525835037231,
      "mae_dy": 0.003235040931031108,
      "pose_mae_dtheta": 0.28578466176986694,
      "pose_mae_dx": 0.08526455610990524,
      "pose_mae_dy": 0.033885419368743896,
      "pose_rmse_dtheta": 0.5799087882041931,
      "pose_rmse_dx": 0.2008732706308365,
      "pose_rmse_dy": 0.08142855018377304,
      "pose_rmse_mean": 0.28740352392196655,
      "rmse_dtheta": 0.06125326454639435,
      "rmse_dx": 0.024197135120630264,
      "rmse_dy": 0.006000083405524492,
      "rmse_mean": 0.030483495444059372,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 8754.0,
      "step": 3489,
      "turn_loss": 0.18571262061595917,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.16214458279130273,
      "grad_norm": 0.9539187550544739,
      "learning_rate": 8.143518293604739e-06,
      "loss": 0.1896,
      "mae_dtheta": 0.03684341162443161,
      "mae_dx": 0.008703603409230709,
      "mae_dy": 0.005301062483340502,
      "pose_mae_dtheta": 0.2782008647918701,
      "pose_mae_dx": 0.07509411126375198,
      "pose_mae_dy": 0.05980120599269867,
      "pose_rmse_dtheta": 0.4877377450466156,
      "pose_rmse_dx": 0.16277019679546356,
      "pose_rmse_dy": 0.14032606780529022,
      "pose_rmse_mean": 0.2636113464832306,
      "rmse_dtheta": 0.05589915066957474,
      "rmse_dx": 0.018667414784431458,
      "rmse_dy": 0.011773813515901566,
      "rmse_mean": 0.028780128806829453,
      "rotation_flip": 0.0049019609577953815,
      "sparse_tokens": 15090.0,
      "step": 3490,
      "turn_loss": 0.30696001648902893,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.1621910425571455,
      "grad_norm": 1.1713385581970215,
      "learning_rate": 8.142489966638223e-06,
      "loss": 0.3052,
      "mae_dtheta": 0.03909342363476753,
      "mae_dx": 0.014454396441578865,
      "mae_dy": 0.006334476638585329,
      "pose_mae_dtheta": 0.32819435000419617,
      "pose_mae_dx": 0.1208573505282402,
      "pose_mae_dy": 0.0790240466594696,
      "pose_rmse_dtheta": 0.5480176210403442,
      "pose_rmse_dx": 0.2469630390405655,
      "pose_rmse_dy": 0.15655319392681122,
      "pose_rmse_mean": 0.317177951335907,
      "rmse_dtheta": 0.05569900944828987,
      "rmse_dx": 0.02711542323231697,
      "rmse_dy": 0.011319417506456375,
      "rmse_mean": 0.03137795254588127,
      "rotation_flip": 0.011204482056200504,
      "sparse_tokens": 18517.0,
      "step": 3491,
      "turn_loss": 0.33616653084754944,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 63189.0,
      "epoch": 0.16223750232298828,
      "grad_norm": 0.7789825201034546,
      "learning_rate": 8.141461419915697e-06,
      "loss": 0.12,
      "mae_dtheta": 0.012975402176380157,
      "mae_dx": 0.002942596562206745,
      "mae_dy": 0.003874189453199506,
      "pose_mae_dtheta": 0.08858086913824081,
      "pose_mae_dx": 0.03839180991053581,
      "pose_mae_dy": 0.034954335540533066,
      "pose_rmse_dtheta": 0.20993751287460327,
      "pose_rmse_dx": 0.11151082068681717,
      "pose_rmse_dy": 0.08308146893978119,
      "pose_rmse_mean": 0.13484327495098114,
      "rmse_dtheta": 0.026446111500263214,
      "rmse_dx": 0.008596676401793957,
      "rmse_dy": 0.009923920966684818,
      "rmse_mean": 0.01498890295624733,
      "rotation_flip": 0.008027522824704647,
      "sparse_tokens": 31989.0,
      "step": 3492,
      "turn_loss": 0.12147475779056549,
      "turns": 194.0,
      "turns_per_sample": 194.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.16228396208883109,
      "grad_norm": 0.5126274824142456,
      "learning_rate": 8.140432653509089e-06,
      "loss": 0.129,
      "mae_dtheta": 0.0367734394967556,
      "mae_dx": 0.010635861195623875,
      "mae_dy": 0.004641993436962366,
      "pose_mae_dtheta": 0.28090524673461914,
      "pose_mae_dx": 0.09345786273479462,
      "pose_mae_dy": 0.05390087142586708,
      "pose_rmse_dtheta": 0.504202127456665,
      "pose_rmse_dx": 0.21881400048732758,
      "pose_rmse_dy": 0.12353376299142838,
      "pose_rmse_mean": 0.28218331933021545,
      "rmse_dtheta": 0.05424785241484642,
      "rmse_dx": 0.0232516061514616,
      "rmse_dy": 0.00888183992356062,
      "rmse_mean": 0.028793765231966972,
      "rotation_flip": 0.0036231884732842445,
      "sparse_tokens": 13584.0,
      "step": 3493,
      "turn_loss": 0.30539670586586,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.16233042185467386,
      "grad_norm": 0.6687670350074768,
      "learning_rate": 8.139403667490338e-06,
      "loss": 0.1616,
      "mae_dtheta": 0.029469182714819908,
      "mae_dx": 0.006096400320529938,
      "mae_dy": 0.00506281154230237,
      "pose_mae_dtheta": 0.2646343410015106,
      "pose_mae_dx": 0.058857131749391556,
      "pose_mae_dy": 0.10125969350337982,
      "pose_rmse_dtheta": 0.49126315116882324,
      "pose_rmse_dx": 0.1395644247531891,
      "pose_rmse_dy": 0.19857239723205566,
      "pose_rmse_mean": 0.2764666676521301,
      "rmse_dtheta": 0.047031112015247345,
      "rmse_dx": 0.01683814823627472,
      "rmse_dy": 0.008384394459426403,
      "rmse_mean": 0.024084551259875298,
      "rotation_flip": 0.007181328721344471,
      "sparse_tokens": 12891.0,
      "step": 3494,
      "turn_loss": 0.17683903872966766,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.16237688162051664,
      "grad_norm": 0.5684400796890259,
      "learning_rate": 8.138374461931404e-06,
      "loss": 0.1485,
      "mae_dtheta": 0.008704906329512596,
      "mae_dx": 0.0017331592971459031,
      "mae_dy": 0.0017794017912819982,
      "pose_mae_dtheta": 0.05866742506623268,
      "pose_mae_dx": 0.018512114882469177,
      "pose_mae_dy": 0.02290116809308529,
      "pose_rmse_dtheta": 0.1485491693019867,
      "pose_rmse_dx": 0.05452948436141014,
      "pose_rmse_dy": 0.05142715200781822,
      "pose_rmse_mean": 0.08483527600765228,
      "rmse_dtheta": 0.019904645159840584,
      "rmse_dx": 0.005224117077887058,
      "rmse_dy": 0.005107878241688013,
      "rmse_mean": 0.010078880935907364,
      "rotation_flip": 0.005469078663736582,
      "sparse_tokens": 32137.0,
      "step": 3495,
      "turn_loss": 0.06508282572031021,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.16242334138635942,
      "grad_norm": 0.48428523540496826,
      "learning_rate": 8.13734503690426e-06,
      "loss": 0.1254,
      "mae_dtheta": 0.007834451273083687,
      "mae_dx": 0.001617109403014183,
      "mae_dy": 0.0015054261311888695,
      "pose_mae_dtheta": 0.05688533931970596,
      "pose_mae_dx": 0.017217174172401428,
      "pose_mae_dy": 0.022278232499957085,
      "pose_rmse_dtheta": 0.1235562190413475,
      "pose_rmse_dx": 0.04079336300492287,
      "pose_rmse_dy": 0.04713545739650726,
      "pose_rmse_mean": 0.07049501687288284,
      "rmse_dtheta": 0.017644383013248444,
      "rmse_dx": 0.0051733036525547504,
      "rmse_dy": 0.003380001289770007,
      "rmse_mean": 0.008732562884688377,
      "rotation_flip": 0.003610108280554414,
      "sparse_tokens": 32137.0,
      "step": 3496,
      "turn_loss": 0.06666357070207596,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1624698011522022,
      "grad_norm": 0.5559055805206299,
      "learning_rate": 8.136315392480893e-06,
      "loss": 0.139,
      "mae_dtheta": 0.009274717420339584,
      "mae_dx": 0.0020130756311118603,
      "mae_dy": 0.0011290482943877578,
      "pose_mae_dtheta": 0.07334677875041962,
      "pose_mae_dx": 0.020213468000292778,
      "pose_mae_dy": 0.020868685096502304,
      "pose_rmse_dtheta": 0.2245645970106125,
      "pose_rmse_dx": 0.052529267966747284,
      "pose_rmse_dy": 0.05190195143222809,
      "pose_rmse_mean": 0.10966527462005615,
      "rmse_dtheta": 0.02645508199930191,
      "rmse_dx": 0.006171462591737509,
      "rmse_dy": 0.002894832519814372,
      "rmse_mean": 0.01184045895934105,
      "rotation_flip": 0.0007097232155501842,
      "sparse_tokens": 32089.0,
      "step": 3497,
      "turn_loss": 0.05404401198029518,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14295.0,
      "epoch": 0.16251626091804497,
      "grad_norm": 0.45234131813049316,
      "learning_rate": 8.13528552873331e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.029446452856063843,
      "mae_dx": 0.01216784305870533,
      "mae_dy": 0.004799839109182358,
      "pose_mae_dtheta": 0.20485445857048035,
      "pose_mae_dx": 0.0980670228600502,
      "pose_mae_dy": 0.06408228725194931,
      "pose_rmse_dtheta": 0.40183064341545105,
      "pose_rmse_dx": 0.23041577637195587,
      "pose_rmse_dy": 0.15375284850597382,
      "pose_rmse_mean": 0.26199978590011597,
      "rmse_dtheta": 0.04962113872170448,
      "rmse_dx": 0.026089558377861977,
      "rmse_dy": 0.009652259759604931,
      "rmse_mean": 0.028454318642616272,
      "rotation_flip": 0.016366612166166306,
      "sparse_tokens": 11678.0,
      "step": 3498,
      "turn_loss": 0.22205348312854767,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.16256272068388775,
      "grad_norm": 1.0129975080490112,
      "learning_rate": 8.134255445733524e-06,
      "loss": 0.2621,
      "mae_dtheta": 0.036393728107213974,
      "mae_dx": 0.01717418059706688,
      "mae_dy": 0.005666207522153854,
      "pose_mae_dtheta": 0.3107668161392212,
      "pose_mae_dx": 0.15453261137008667,
      "pose_mae_dy": 0.07603316754102707,
      "pose_rmse_dtheta": 0.5353161096572876,
      "pose_rmse_dx": 0.32996687293052673,
      "pose_rmse_dy": 0.17499135434627533,
      "pose_rmse_mean": 0.3467581272125244,
      "rmse_dtheta": 0.054702188819646835,
      "rmse_dx": 0.032298050820827484,
      "rmse_dy": 0.011669832281768322,
      "rmse_mean": 0.03289002180099487,
      "rotation_flip": 0.007692307699471712,
      "sparse_tokens": 22816.0,
      "step": 3499,
      "turn_loss": 0.2774816155433655,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.16260918044973052,
      "grad_norm": 0.6832457780838013,
      "learning_rate": 8.133225143553574e-06,
      "loss": 0.1531,
      "mae_dtheta": 0.04002205654978752,
      "mae_dx": 0.011675935238599777,
      "mae_dy": 0.003921248950064182,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6832459568977356,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 141.08863830566406,
      "model/head/act_norm_mean": 100.76474144345238,
      "model/head/act_norm_min": 72.73963165283203,
      "model/head/act_over_embed": 69.24647369431297,
      "model/head/grad_frac": 0.09591896831989288,
      "model/head/grad_norm": 0.0655362457036972,
      "model/head/grad_zero_frac": 0.00018084491603076458,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6916387648809523,
      "model/head/update_ratio": 0.001128535601310432,
      "model/head/weight_delta": 6.970466613769531,
      "model/head/weight_delta_rel": 0.12228263169527054,
      "model/head/weight_norm": 58.07193374633789,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4167569875717163,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4167569875717163,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4167569875717163,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.286399303599674,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11332434415817261,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07742840051651001,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002509875688701868,
      "model/modality_embedder.encoders.pose/weight_delta": 2.2891814708709717,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0747946947813034,
      "model/modality_embedder.encoders.pose/weight_norm": 30.84949493408203,
      "model/modality_embedder/grad_frac": 0.11332434415817261,
      "model/modality_embedder/grad_norm": 0.07742840051651001,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.002509875688701868,
      "model/modality_embedder/weight_delta": 2.2891814708709717,
      "model/modality_embedder/weight_delta_rel": 0.0747946947813034,
      "model/modality_embedder/weight_norm": 30.84949493408203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.56918334960938,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.601023655990176,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.274782180786133,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.531635050513636,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07492266595363617,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.051190607249736786,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018470286158844829,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.5816378593444824,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0576358363032341,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.715112686157227,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.3388671875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.447835470993954,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.778972625732422,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.113572057761353,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07509656250476837,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05130942165851593,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017476867651566863,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 1.9968801736831665,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06917349249124527,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.358476638793945,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.99303436279297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.075113378684808,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.563349723815918,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.231852670742306,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07073965668678284,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.048332586884498596,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015947475330904126,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.1410088539123535,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07189106941223145,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.30735969543457,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 75.72908020019531,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.03124114229025,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.624570846557617,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.576121983448623,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07787672430276871,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05320895463228226,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017953243805095553,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.8277156352996826,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06246264651417732,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.637516021728516,
      "model/normalizer/grad_frac": 0.2794108986854553,
      "model/normalizer/grad_norm": 0.1909063756465912,
      "model/normalizer/grad_zero_frac": 0.00022689378238283098,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002441347809508443,
      "model/normalizer/weight_delta": 3.885765314102173,
      "model/normalizer/weight_delta_rel": 0.050046406686306,
      "model/normalizer/weight_norm": 78.1971206665039,
      "pose_mae_dtheta": 0.30959928035736084,
      "pose_mae_dx": 0.08643177896738052,
      "pose_mae_dy": 0.05992038920521736,
      "pose_rmse_dtheta": 0.5584402084350586,
      "pose_rmse_dx": 0.2012224942445755,
      "pose_rmse_dy": 0.1452912837266922,
      "pose_rmse_mean": 0.30165132880210876,
      "rmse_dtheta": 0.05957914516329765,
      "rmse_dx": 0.02423842065036297,
      "rmse_dy": 0.008242471143603325,
      "rmse_mean": 0.03068668022751808,
      "rotation_flip": 0.01056338008493185,
      "sparse_tokens": 5494.0,
      "step": 3500,
      "turn_loss": 0.26138177514076233,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 8465.0,
      "epoch": 0.16265564021557333,
      "grad_norm": 0.9267454743385315,
      "learning_rate": 8.132194622265508e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.045523084700107574,
      "mae_dx": 0.015139855444431305,
      "mae_dy": 0.005767407361418009,
      "pose_mae_dtheta": 0.33354103565216064,
      "pose_mae_dx": 0.10911336541175842,
      "pose_mae_dy": 0.05247632414102554,
      "pose_rmse_dtheta": 0.5290737748146057,
      "pose_rmse_dx": 0.2269398719072342,
      "pose_rmse_dy": 0.11580932885408401,
      "pose_rmse_mean": 0.29060766100883484,
      "rmse_dtheta": 0.06310196220874786,
      "rmse_dx": 0.027691829949617386,
      "rmse_dy": 0.01216909196227789,
      "rmse_mean": 0.03432096168398857,
      "rotation_flip": 0.014354066923260689,
      "sparse_tokens": 6756.0,
      "step": 3501,
      "turn_loss": 0.26427745819091797,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.1627020999814161,
      "grad_norm": 0.8459670543670654,
      "learning_rate": 8.131163881941389e-06,
      "loss": 0.27,
      "mae_dtheta": 0.03270891308784485,
      "mae_dx": 0.0037554558366537094,
      "mae_dy": 0.007565391715615988,
      "pose_mae_dtheta": 0.27936679124832153,
      "pose_mae_dx": 0.05134843289852142,
      "pose_mae_dy": 0.09068259596824646,
      "pose_rmse_dtheta": 0.5301194190979004,
      "pose_rmse_dx": 0.10648270696401596,
      "pose_rmse_dy": 0.17713622748851776,
      "pose_rmse_mean": 0.27124613523483276,
      "rmse_dtheta": 0.050174955278635025,
      "rmse_dx": 0.009370061568915844,
      "rmse_dy": 0.012476257048547268,
      "rmse_mean": 0.024007093161344528,
      "rotation_flip": 0.0060606058686971664,
      "sparse_tokens": 5877.0,
      "step": 3502,
      "turn_loss": 0.19753819704055786,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.16274855974725888,
      "grad_norm": 0.5094886422157288,
      "learning_rate": 8.1301329226533e-06,
      "loss": 0.1042,
      "mae_dtheta": 0.015722233802080154,
      "mae_dx": 0.0023592289071530104,
      "mae_dy": 0.003461261047050357,
      "pose_mae_dtheta": 0.10981123149394989,
      "pose_mae_dx": 0.038368262350559235,
      "pose_mae_dy": 0.04575533792376518,
      "pose_rmse_dtheta": 0.21654340624809265,
      "pose_rmse_dx": 0.08417608588933945,
      "pose_rmse_dy": 0.10026155412197113,
      "pose_rmse_mean": 0.13366036117076874,
      "rmse_dtheta": 0.027889633551239967,
      "rmse_dx": 0.005976834334433079,
      "rmse_dy": 0.006544230505824089,
      "rmse_mean": 0.013470232486724854,
      "rotation_flip": 0.008752735331654549,
      "sparse_tokens": 32057.0,
      "step": 3503,
      "turn_loss": 0.14012375473976135,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16279501951310166,
      "grad_norm": 0.5738299489021301,
      "learning_rate": 8.129101744473335e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.010658178478479385,
      "mae_dx": 0.0017670374363660812,
      "mae_dy": 0.0020473310723900795,
      "pose_mae_dtheta": 0.07617752999067307,
      "pose_mae_dx": 0.02107667177915573,
      "pose_mae_dy": 0.029372425749897957,
      "pose_rmse_dtheta": 0.19575782120227814,
      "pose_rmse_dx": 0.056541554629802704,
      "pose_rmse_dy": 0.0781097263097763,
      "pose_rmse_mean": 0.11013637483119965,
      "rmse_dtheta": 0.023429499939084053,
      "rmse_dx": 0.005261326674371958,
      "rmse_dy": 0.004761903081089258,
      "rmse_mean": 0.011150910519063473,
      "rotation_flip": 0.004905968904495239,
      "sparse_tokens": 32105.0,
      "step": 3504,
      "turn_loss": 0.08462082594633102,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.16284147927894443,
      "grad_norm": 0.5220845341682434,
      "learning_rate": 8.128070347473609e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.04379555583000183,
      "mae_dx": 0.01655017025768757,
      "mae_dy": 0.007381114177405834,
      "pose_mae_dtheta": 0.35568732023239136,
      "pose_mae_dx": 0.11975092440843582,
      "pose_mae_dy": 0.06305970996618271,
      "pose_rmse_dtheta": 0.6032299995422363,
      "pose_rmse_dx": 0.25051069259643555,
      "pose_rmse_dy": 0.15101203322410583,
      "pose_rmse_mean": 0.3349176049232483,
      "rmse_dtheta": 0.06384575366973877,
      "rmse_dx": 0.02945825830101967,
      "rmse_dy": 0.016992112621665,
      "rmse_mean": 0.03676537424325943,
      "rotation_flip": 0.018115941435098648,
      "sparse_tokens": 9684.0,
      "step": 3505,
      "turn_loss": 0.3820098638534546,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1628879390447872,
      "grad_norm": 0.4057043790817261,
      "learning_rate": 8.127038731726241e-06,
      "loss": 0.0931,
      "mae_dtheta": 0.00781687255948782,
      "mae_dx": 0.0016375629929825664,
      "mae_dy": 0.0011114333756268024,
      "pose_mae_dtheta": 0.05730641260743141,
      "pose_mae_dx": 0.01656574010848999,
      "pose_mae_dy": 0.015362856909632683,
      "pose_rmse_dtheta": 0.17325390875339508,
      "pose_rmse_dx": 0.046147797256708145,
      "pose_rmse_dy": 0.03976800665259361,
      "pose_rmse_mean": 0.08638989925384521,
      "rmse_dtheta": 0.02167069911956787,
      "rmse_dx": 0.005587405990809202,
      "rmse_dy": 0.0029313338454812765,
      "rmse_mean": 0.01006314717233181,
      "rotation_flip": 0.0021019442938268185,
      "sparse_tokens": 32105.0,
      "step": 3506,
      "turn_loss": 0.056507378816604614,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.16293439881063,
      "grad_norm": 0.9606012105941772,
      "learning_rate": 8.126006897303378e-06,
      "loss": 0.2468,
      "mae_dtheta": 0.026066062971949577,
      "mae_dx": 0.013980147428810596,
      "mae_dy": 0.006995754782110453,
      "pose_mae_dtheta": 0.18576155602931976,
      "pose_mae_dx": 0.11189500987529755,
      "pose_mae_dy": 0.1041712611913681,
      "pose_rmse_dtheta": 0.37692004442214966,
      "pose_rmse_dx": 0.25713667273521423,
      "pose_rmse_dy": 0.22536982595920563,
      "pose_rmse_mean": 0.2864755094051361,
      "rmse_dtheta": 0.043588846921920776,
      "rmse_dx": 0.02870800346136093,
      "rmse_dy": 0.012711770832538605,
      "rmse_mean": 0.028336208313703537,
      "rotation_flip": 0.01175213698297739,
      "sparse_tokens": 20671.0,
      "step": 3507,
      "turn_loss": 0.2420973926782608,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.16298085857647276,
      "grad_norm": 0.7481220364570618,
      "learning_rate": 8.124974844277173e-06,
      "loss": 0.1478,
      "mae_dtheta": 0.02787087857723236,
      "mae_dx": 0.01095209177583456,
      "mae_dy": 0.0058690751902759075,
      "pose_mae_dtheta": 0.2170240581035614,
      "pose_mae_dx": 0.08410456776618958,
      "pose_mae_dy": 0.07774503529071808,
      "pose_rmse_dtheta": 0.3879535496234894,
      "pose_rmse_dx": 0.20575225353240967,
      "pose_rmse_dy": 0.18136140704154968,
      "pose_rmse_mean": 0.2583557367324829,
      "rmse_dtheta": 0.04328843951225281,
      "rmse_dx": 0.023706190288066864,
      "rmse_dy": 0.011610209010541439,
      "rmse_mean": 0.026201613247394562,
      "rotation_flip": 0.022123893722891808,
      "sparse_tokens": 15781.0,
      "step": 3508,
      "turn_loss": 0.2439194768667221,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16302731834231554,
      "grad_norm": 0.559762716293335,
      "learning_rate": 8.123942572719801e-06,
      "loss": 0.1215,
      "mae_dtheta": 0.012827565893530846,
      "mae_dx": 0.0023781214840710163,
      "mae_dy": 0.003778642974793911,
      "pose_mae_dtheta": 0.09121610224246979,
      "pose_mae_dx": 0.0381195954978466,
      "pose_mae_dy": 0.041835036128759384,
      "pose_rmse_dtheta": 0.20668591558933258,
      "pose_rmse_dx": 0.08817243576049805,
      "pose_rmse_dy": 0.09218426048755646,
      "pose_rmse_mean": 0.12901419401168823,
      "rmse_dtheta": 0.025276534259319305,
      "rmse_dx": 0.005990664009004831,
      "rmse_dy": 0.007565873675048351,
      "rmse_mean": 0.0129443584010005,
      "rotation_flip": 0.0036443148273974657,
      "sparse_tokens": 32105.0,
      "step": 3509,
      "turn_loss": 0.1056194081902504,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.16307377810815835,
      "grad_norm": 0.720647394657135,
      "learning_rate": 8.122910082703449e-06,
      "loss": 0.1513,
      "mae_dtheta": 0.01214354857802391,
      "mae_dx": 0.0024738728534430265,
      "mae_dy": 0.002844497561454773,
      "pose_mae_dtheta": 0.08099815994501114,
      "pose_mae_dx": 0.030603785067796707,
      "pose_mae_dy": 0.03239230811595917,
      "pose_rmse_dtheta": 0.17389079928398132,
      "pose_rmse_dx": 0.07621033489704132,
      "pose_rmse_dy": 0.07172102481126785,
      "pose_rmse_mean": 0.10727405548095703,
      "rmse_dtheta": 0.024195881560444832,
      "rmse_dx": 0.007208492141216993,
      "rmse_dy": 0.0060334219597280025,
      "rmse_mean": 0.012479264289140701,
      "rotation_flip": 0.0048510050401091576,
      "sparse_tokens": 32153.0,
      "step": 3510,
      "turn_loss": 0.1085701733827591,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.16312023787400112,
      "grad_norm": 0.3790587782859802,
      "learning_rate": 8.121877374300318e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.010844229720532894,
      "mae_dx": 0.0018556737340986729,
      "mae_dy": 0.0028333195950835943,
      "pose_mae_dtheta": 0.07240794599056244,
      "pose_mae_dx": 0.027213696390390396,
      "pose_mae_dy": 0.034875791519880295,
      "pose_rmse_dtheta": 0.14364498853683472,
      "pose_rmse_dx": 0.07247285544872284,
      "pose_rmse_dy": 0.07800634205341339,
      "pose_rmse_mean": 0.09804140031337738,
      "rmse_dtheta": 0.020833805203437805,
      "rmse_dx": 0.005907395388931036,
      "rmse_dy": 0.006015223916620016,
      "rmse_mean": 0.010918809100985527,
      "rotation_flip": 0.005505308508872986,
      "sparse_tokens": 32041.0,
      "step": 3511,
      "turn_loss": 0.09370790421962738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1631666976398439,
      "grad_norm": 0.520156979560852,
      "learning_rate": 8.120844447582627e-06,
      "loss": 0.1072,
      "mae_dtheta": 0.007464494090527296,
      "mae_dx": 0.0012669877614825964,
      "mae_dy": 0.0012585027143359184,
      "pose_mae_dtheta": 0.055996254086494446,
      "pose_mae_dx": 0.014219683595001698,
      "pose_mae_dy": 0.019755838438868523,
      "pose_rmse_dtheta": 0.1682610660791397,
      "pose_rmse_dx": 0.03909920156002045,
      "pose_rmse_dy": 0.04836316406726837,
      "pose_rmse_mean": 0.08524113893508911,
      "rmse_dtheta": 0.021100426092743874,
      "rmse_dx": 0.004507065750658512,
      "rmse_dy": 0.0026587285101413727,
      "rmse_mean": 0.00942207407206297,
      "rotation_flip": 0.0016648168675601482,
      "sparse_tokens": 32073.0,
      "step": 3512,
      "turn_loss": 0.057494692504405975,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.16321315740568668,
      "grad_norm": 0.7001296281814575,
      "learning_rate": 8.119811302622608e-06,
      "loss": 0.2249,
      "mae_dtheta": 0.0169887226074934,
      "mae_dx": 0.003655551001429558,
      "mae_dy": 0.005619122181087732,
      "pose_mae_dtheta": 0.120490163564682,
      "pose_mae_dx": 0.04050350934267044,
      "pose_mae_dy": 0.048776641488075256,
      "pose_rmse_dtheta": 0.3038550317287445,
      "pose_rmse_dx": 0.10276287794113159,
      "pose_rmse_dy": 0.11620314419269562,
      "pose_rmse_mean": 0.17427369952201843,
      "rmse_dtheta": 0.03354613110423088,
      "rmse_dx": 0.009013745933771133,
      "rmse_dy": 0.012047081254422665,
      "rmse_mean": 0.018202319741249084,
      "rotation_flip": 0.007479674648493528,
      "sparse_tokens": 32137.0,
      "step": 3513,
      "turn_loss": 0.16974613070487976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.16325961717152945,
      "grad_norm": 0.6332796216011047,
      "learning_rate": 8.11877793949251e-06,
      "loss": 0.2128,
      "mae_dtheta": 0.0249503031373024,
      "mae_dx": 0.007932452484965324,
      "mae_dy": 0.004528532736003399,
      "pose_mae_dtheta": 0.19811709225177765,
      "pose_mae_dx": 0.07402555644512177,
      "pose_mae_dy": 0.06675714999437332,
      "pose_rmse_dtheta": 0.39057502150535583,
      "pose_rmse_dx": 0.17831997573375702,
      "pose_rmse_dy": 0.1634596735239029,
      "pose_rmse_mean": 0.24411821365356445,
      "rmse_dtheta": 0.042705513536930084,
      "rmse_dx": 0.019637983292341232,
      "rmse_dy": 0.009198779240250587,
      "rmse_mean": 0.02384742721915245,
      "rotation_flip": 0.017777778208255768,
      "sparse_tokens": 13306.0,
      "step": 3514,
      "turn_loss": 0.18314608931541443,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.16330607693737223,
      "grad_norm": 0.976167619228363,
      "learning_rate": 8.117744358264597e-06,
      "loss": 0.2868,
      "mae_dtheta": 0.03871462866663933,
      "mae_dx": 0.009253105148673058,
      "mae_dy": 0.004085649270564318,
      "pose_mae_dtheta": 0.32138702273368835,
      "pose_mae_dx": 0.08367153257131577,
      "pose_mae_dy": 0.05801961198449135,
      "pose_rmse_dtheta": 0.5684100985527039,
      "pose_rmse_dx": 0.19573037326335907,
      "pose_rmse_dy": 0.13500531017780304,
      "pose_rmse_mean": 0.2997152805328369,
      "rmse_dtheta": 0.05790957808494568,
      "rmse_dx": 0.020953470841050148,
      "rmse_dy": 0.008119921199977398,
      "rmse_mean": 0.028994321823120117,
      "rotation_flip": 0.008279669098556042,
      "sparse_tokens": 17458.0,
      "step": 3515,
      "turn_loss": 0.3055838644504547,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.163352536703215,
      "grad_norm": 0.5446810722351074,
      "learning_rate": 8.116710559011147e-06,
      "loss": 0.0805,
      "mae_dtheta": 0.009012165479362011,
      "mae_dx": 0.002066798973828554,
      "mae_dy": 0.0017580216517671943,
      "pose_mae_dtheta": 0.061844322830438614,
      "pose_mae_dx": 0.02323322556912899,
      "pose_mae_dy": 0.026305021718144417,
      "pose_rmse_dtheta": 0.1650361716747284,
      "pose_rmse_dx": 0.06930271536111832,
      "pose_rmse_dy": 0.07047371566295624,
      "pose_rmse_mean": 0.10160420835018158,
      "rmse_dtheta": 0.021012885496020317,
      "rmse_dx": 0.007224555592983961,
      "rmse_dy": 0.0038373845163732767,
      "rmse_mean": 0.010691609233617783,
      "rotation_flip": 0.0035252643283456564,
      "sparse_tokens": 32057.0,
      "step": 3516,
      "turn_loss": 0.07070310413837433,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64409.0,
      "epoch": 0.16339899646905778,
      "grad_norm": 0.32188206911087036,
      "learning_rate": 8.115676541804456e-06,
      "loss": 0.0884,
      "mae_dtheta": 0.006635739468038082,
      "mae_dx": 0.001000218209810555,
      "mae_dy": 0.0013561584055423737,
      "pose_mae_dtheta": 0.049030326306819916,
      "pose_mae_dx": 0.014014801941812038,
      "pose_mae_dy": 0.023262742906808853,
      "pose_rmse_dtheta": 0.12374500185251236,
      "pose_rmse_dx": 0.043906815350055695,
      "pose_rmse_dy": 0.05624837428331375,
      "pose_rmse_mean": 0.0746334046125412,
      "rmse_dtheta": 0.016833538189530373,
      "rmse_dx": 0.0038203636649996042,
      "rmse_dy": 0.0029221430886536837,
      "rmse_mean": 0.007858682423830032,
      "rotation_flip": 0.008014796301722527,
      "sparse_tokens": 32009.0,
      "step": 3517,
      "turn_loss": 0.05410601571202278,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.1634454562349006,
      "grad_norm": 0.5793553590774536,
      "learning_rate": 8.114642306716832e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.03448612242937088,
      "mae_dx": 0.01587524078786373,
      "mae_dy": 0.005814241245388985,
      "pose_mae_dtheta": 0.28346964716911316,
      "pose_mae_dx": 0.12093621492385864,
      "pose_mae_dy": 0.07837643474340439,
      "pose_rmse_dtheta": 0.49399012327194214,
      "pose_rmse_dx": 0.2721160650253296,
      "pose_rmse_dy": 0.1823035180568695,
      "pose_rmse_mean": 0.31613656878471375,
      "rmse_dtheta": 0.0546916127204895,
      "rmse_dx": 0.030887989327311516,
      "rmse_dy": 0.01081710122525692,
      "rmse_mean": 0.032132238149642944,
      "rotation_flip": 0.013605441898107529,
      "sparse_tokens": 9355.0,
      "step": 3518,
      "turn_loss": 0.24299366772174835,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16349191600074336,
      "grad_norm": 0.528721809387207,
      "learning_rate": 8.1136078538206e-06,
      "loss": 0.1159,
      "mae_dtheta": 0.010629074648022652,
      "mae_dx": 0.0016178563237190247,
      "mae_dy": 0.00214646989479661,
      "pose_mae_dtheta": 0.06883704662322998,
      "pose_mae_dx": 0.019771715626120567,
      "pose_mae_dy": 0.029391862452030182,
      "pose_rmse_dtheta": 0.16460880637168884,
      "pose_rmse_dx": 0.0487389862537384,
      "pose_rmse_dy": 0.07529531419277191,
      "pose_rmse_mean": 0.09621437638998032,
      "rmse_dtheta": 0.02111765369772911,
      "rmse_dx": 0.004863797686994076,
      "rmse_dy": 0.00427741464227438,
      "rmse_mean": 0.01008628960698843,
      "rotation_flip": 0.00428418442606926,
      "sparse_tokens": 32105.0,
      "step": 3519,
      "turn_loss": 0.08102289587259293,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.16353837576658614,
      "grad_norm": 0.4856908619403839,
      "learning_rate": 8.112573183188099e-06,
      "loss": 0.096,
      "mae_dtheta": 0.01311798207461834,
      "mae_dx": 0.003531967755407095,
      "mae_dy": 0.0028209888841956854,
      "pose_mae_dtheta": 0.09732536971569061,
      "pose_mae_dx": 0.03224429488182068,
      "pose_mae_dy": 0.029563821852207184,
      "pose_rmse_dtheta": 0.2464718371629715,
      "pose_rmse_dx": 0.087607242166996,
      "pose_rmse_dy": 0.07312756776809692,
      "pose_rmse_mean": 0.13573555648326874,
      "rmse_dtheta": 0.02997441217303276,
      "rmse_dx": 0.01068032719194889,
      "rmse_dy": 0.007688615005463362,
      "rmse_mean": 0.016114452853798866,
      "rotation_flip": 0.004217629786580801,
      "sparse_tokens": 32153.0,
      "step": 3520,
      "turn_loss": 0.12902504205703735,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.16358483553242892,
      "grad_norm": 0.37812548875808716,
      "learning_rate": 8.111538294891684e-06,
      "loss": 0.0933,
      "mae_dtheta": 0.008761066943407059,
      "mae_dx": 0.0015642900252714753,
      "mae_dy": 0.002109841676428914,
      "pose_mae_dtheta": 0.06357495486736298,
      "pose_mae_dx": 0.018557989969849586,
      "pose_mae_dy": 0.02696147933602333,
      "pose_rmse_dtheta": 0.17255181074142456,
      "pose_rmse_dx": 0.045666538178920746,
      "pose_rmse_dy": 0.0700840950012207,
      "pose_rmse_mean": 0.0961008220911026,
      "rmse_dtheta": 0.0208872202783823,
      "rmse_dx": 0.004872524179518223,
      "rmse_dy": 0.005162281449884176,
      "rmse_mean": 0.010307342745363712,
      "rotation_flip": 0.004566209856420755,
      "sparse_tokens": 32073.0,
      "step": 3521,
      "turn_loss": 0.06266190111637115,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1636312952982717,
      "grad_norm": 0.5336090326309204,
      "learning_rate": 8.110503189003726e-06,
      "loss": 0.1334,
      "mae_dtheta": 0.015037862583994865,
      "mae_dx": 0.001782720908522606,
      "mae_dy": 0.002670400543138385,
      "pose_mae_dtheta": 0.10638682544231415,
      "pose_mae_dx": 0.027467289939522743,
      "pose_mae_dy": 0.039959244430065155,
      "pose_rmse_dtheta": 0.22907724976539612,
      "pose_rmse_dx": 0.06545770168304443,
      "pose_rmse_dy": 0.0903189554810524,
      "pose_rmse_mean": 0.12828463315963745,
      "rmse_dtheta": 0.02930545248091221,
      "rmse_dx": 0.0054284632205963135,
      "rmse_dy": 0.005269428715109825,
      "rmse_mean": 0.01333444844931364,
      "rotation_flip": 0.005392912309616804,
      "sparse_tokens": 32073.0,
      "step": 3522,
      "turn_loss": 0.1012384369969368,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.16367775506411447,
      "grad_norm": 0.44807952642440796,
      "learning_rate": 8.109467865596612e-06,
      "loss": 0.0698,
      "mae_dtheta": 0.006431701127439737,
      "mae_dx": 0.0014024304691702127,
      "mae_dy": 0.0012592460261657834,
      "pose_mae_dtheta": 0.04578297212719917,
      "pose_mae_dx": 0.015360408462584019,
      "pose_mae_dy": 0.019129157066345215,
      "pose_rmse_dtheta": 0.10727398097515106,
      "pose_rmse_dx": 0.03828521445393562,
      "pose_rmse_dy": 0.05085286498069763,
      "pose_rmse_mean": 0.06547068804502487,
      "rmse_dtheta": 0.01603134535253048,
      "rmse_dx": 0.004271876998245716,
      "rmse_dy": 0.0028826072812080383,
      "rmse_mean": 0.007728610187768936,
      "rotation_flip": 0.0020222447346895933,
      "sparse_tokens": 32121.0,
      "step": 3523,
      "turn_loss": 0.057475745677948,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.16372421482995725,
      "grad_norm": 0.5708958506584167,
      "learning_rate": 8.108432324742741e-06,
      "loss": 0.1062,
      "mae_dtheta": 0.008513353765010834,
      "mae_dx": 0.0017733641434460878,
      "mae_dy": 0.0016370197990909219,
      "pose_mae_dtheta": 0.06249932944774628,
      "pose_mae_dx": 0.023104021325707436,
      "pose_mae_dy": 0.025031106546521187,
      "pose_rmse_dtheta": 0.1912250965833664,
      "pose_rmse_dx": 0.0674155056476593,
      "pose_rmse_dy": 0.06609299033880234,
      "pose_rmse_mean": 0.10824453085660934,
      "rmse_dtheta": 0.021683108061552048,
      "rmse_dx": 0.006084480322897434,
      "rmse_dy": 0.0038495436310768127,
      "rmse_mean": 0.010539043694734573,
      "rotation_flip": 0.0005081300623714924,
      "sparse_tokens": 32041.0,
      "step": 3524,
      "turn_loss": 0.06890375167131424,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.16377067459580003,
      "grad_norm": 0.666618287563324,
      "learning_rate": 8.107396566514528e-06,
      "loss": 0.1616,
      "mae_dtheta": 0.05453166738152504,
      "mae_dx": 0.012232530862092972,
      "mae_dy": 0.004894176963716745,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6666183471679688,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 121.18311309814453,
      "model/head/act_norm_mean": 101.64044658954327,
      "model/head/act_norm_min": 93.00593566894531,
      "model/head/act_over_embed": 69.84826646918738,
      "model/head/grad_frac": 0.09953093528747559,
      "model/head/grad_norm": 0.06634914875030518,
      "model/head/grad_zero_frac": 0.00013420595496427268,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6953876201923077,
      "model/head/update_ratio": 0.0011423879768699408,
      "model/head/weight_delta": 6.999600887298584,
      "model/head/weight_delta_rel": 0.12279373407363892,
      "model/head/weight_norm": 58.079345703125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41693973541259766,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41693973541259766,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41693973541259766,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2865248896268399,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09084425121545792,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06055844575166702,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019629537127912045,
      "model/modality_embedder.encoders.pose/weight_delta": 2.299978017807007,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07514744997024536,
      "model/modality_embedder.encoders.pose/weight_norm": 30.85067367553711,
      "model/modality_embedder/grad_frac": 0.09084425121545792,
      "model/modality_embedder/grad_norm": 0.06055844575166702,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0019629537127912045,
      "model/modality_embedder/weight_delta": 2.299978017807007,
      "model/modality_embedder/weight_delta_rel": 0.07514744997024536,
      "model/modality_embedder/weight_norm": 30.85067367553711,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 58.82754135131836,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.76852249313187,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.50745964050293,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.646741819546227,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09033174812793732,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06021679937839508,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002172569278627634,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.5898851156234741,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.057936374098062515,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.716859817504883,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 60.35636520385742,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.646315056471305,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.984475135803223,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.24996908709654,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07956971228122711,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05304263159632683,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018065525218844414,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.0080606937408447,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06956078857183456,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.36124610900879,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 62.235233306884766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.259219513125764,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.560142517089844,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.35837212995892,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07538440823554993,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.050252627581357956,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016579896910116076,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.152590751647949,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07227996736764908,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.309371948242188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 63.48738479614258,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.212520985958484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.585050582885742,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.70069918918607,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07086079567670822,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.047237105667591095,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015937702264636755,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.8368152379989624,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06277363002300262,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.638591766357422,
      "model/normalizer/grad_frac": 0.2668260335922241,
      "model/normalizer/grad_norm": 0.17787112295627594,
      "model/normalizer/grad_zero_frac": 0.00017017032951116562,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002274575177580118,
      "model/normalizer/weight_delta": 3.9066996574401855,
      "model/normalizer/weight_delta_rel": 0.05031602829694748,
      "model/normalizer/weight_norm": 78.19971466064453,
      "pose_mae_dtheta": 0.5080665349960327,
      "pose_mae_dx": 0.10381650924682617,
      "pose_mae_dy": 0.035936009138822556,
      "pose_rmse_dtheta": 0.7507970333099365,
      "pose_rmse_dx": 0.20658111572265625,
      "pose_rmse_dy": 0.0739654079079628,
      "pose_rmse_mean": 0.3437812030315399,
      "rmse_dtheta": 0.07094556838274002,
      "rmse_dx": 0.02225266769528389,
      "rmse_dy": 0.009969649836421013,
      "rmse_mean": 0.034389298409223557,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 3458.0,
      "step": 3525,
      "turn_loss": 0.3742780089378357,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.16381713436164283,
      "grad_norm": 0.4125661551952362,
      "learning_rate": 8.106360590984406e-06,
      "loss": 0.0791,
      "mae_dtheta": 0.007038278039544821,
      "mae_dx": 0.0015419498085975647,
      "mae_dy": 0.0015373750356957316,
      "pose_mae_dtheta": 0.04905767738819122,
      "pose_mae_dx": 0.017451884225010872,
      "pose_mae_dy": 0.016731588169932365,
      "pose_rmse_dtheta": 0.15521101653575897,
      "pose_rmse_dx": 0.07068794220685959,
      "pose_rmse_dy": 0.04155705124139786,
      "pose_rmse_mean": 0.08915200084447861,
      "rmse_dtheta": 0.020275302231311798,
      "rmse_dx": 0.0059461044147610664,
      "rmse_dy": 0.004709320608526468,
      "rmse_mean": 0.01031024195253849,
      "rotation_flip": 0.0032608695328235626,
      "sparse_tokens": 32057.0,
      "step": 3526,
      "turn_loss": 0.06020569056272507,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1638635941274856,
      "grad_norm": 0.4978821277618408,
      "learning_rate": 8.105324398224821e-06,
      "loss": 0.0784,
      "mae_dtheta": 0.009528625756502151,
      "mae_dx": 0.0016571894520893693,
      "mae_dy": 0.0018246895633637905,
      "pose_mae_dtheta": 0.06463305652141571,
      "pose_mae_dx": 0.02034711465239525,
      "pose_mae_dy": 0.022834472358226776,
      "pose_rmse_dtheta": 0.18654057383537292,
      "pose_rmse_dx": 0.04641754552721977,
      "pose_rmse_dy": 0.051905084401369095,
      "pose_rmse_mean": 0.09495440125465393,
      "rmse_dtheta": 0.022117985412478447,
      "rmse_dx": 0.004949874710291624,
      "rmse_dy": 0.003867202904075384,
      "rmse_mean": 0.010311688296496868,
      "rotation_flip": 0.0020610056817531586,
      "sparse_tokens": 32137.0,
      "step": 3527,
      "turn_loss": 0.07169421017169952,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.16391005389332838,
      "grad_norm": 0.4922693073749542,
      "learning_rate": 8.104287988308233e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.009164173156023026,
      "mae_dx": 0.0017575357342138886,
      "mae_dy": 0.001815102412365377,
      "pose_mae_dtheta": 0.06385159492492676,
      "pose_mae_dx": 0.021728601306676865,
      "pose_mae_dy": 0.023213712498545647,
      "pose_rmse_dtheta": 0.1535511463880539,
      "pose_rmse_dx": 0.04741481691598892,
      "pose_rmse_dy": 0.05698111653327942,
      "pose_rmse_mean": 0.08598236739635468,
      "rmse_dtheta": 0.019460149109363556,
      "rmse_dx": 0.004790319595485926,
      "rmse_dy": 0.0037475498393177986,
      "rmse_mean": 0.009332673624157906,
      "rotation_flip": 0.002847988624125719,
      "sparse_tokens": 32169.0,
      "step": 3528,
      "turn_loss": 0.06772784143686295,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.16395651365917116,
      "grad_norm": 0.48128387331962585,
      "learning_rate": 8.10325136130712e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.01044281106442213,
      "mae_dx": 0.0019618808291852474,
      "mae_dy": 0.002047210233286023,
      "pose_mae_dtheta": 0.075285404920578,
      "pose_mae_dx": 0.022383563220500946,
      "pose_mae_dy": 0.02843332290649414,
      "pose_rmse_dtheta": 0.197954922914505,
      "pose_rmse_dx": 0.058598682284355164,
      "pose_rmse_dy": 0.06299974024295807,
      "pose_rmse_mean": 0.10651777684688568,
      "rmse_dtheta": 0.02354545146226883,
      "rmse_dx": 0.007141914218664169,
      "rmse_dy": 0.004641558509320021,
      "rmse_mean": 0.01177630852907896,
      "rotation_flip": 0.0014880952658131719,
      "sparse_tokens": 32041.0,
      "step": 3529,
      "turn_loss": 0.07970735430717468,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34388.0,
      "epoch": 0.16400297342501394,
      "grad_norm": 0.6021180748939514,
      "learning_rate": 8.102214517293973e-06,
      "loss": 0.1823,
      "mae_dtheta": 0.029999447986483574,
      "mae_dx": 0.015048282220959663,
      "mae_dy": 0.009684297256171703,
      "pose_mae_dtheta": 0.2054968625307083,
      "pose_mae_dx": 0.12677425146102905,
      "pose_mae_dy": 0.10011770576238632,
      "pose_rmse_dtheta": 0.33980682492256165,
      "pose_rmse_dx": 0.25815334916114807,
      "pose_rmse_dy": 0.21978731453418732,
      "pose_rmse_mean": 0.2725825011730194,
      "rmse_dtheta": 0.044941481202840805,
      "rmse_dx": 0.027594011276960373,
      "rmse_dy": 0.018732937052845955,
      "rmse_mean": 0.030422810465097427,
      "rotation_flip": 0.010897436179220676,
      "sparse_tokens": 28563.0,
      "step": 3530,
      "turn_loss": 0.34900110960006714,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.1640494331908567,
      "grad_norm": 0.5302410125732422,
      "learning_rate": 8.101177456341301e-06,
      "loss": 0.1691,
      "mae_dtheta": 0.03183060884475708,
      "mae_dx": 0.011591402813792229,
      "mae_dy": 0.004599082283675671,
      "pose_mae_dtheta": 0.25050562620162964,
      "pose_mae_dx": 0.10115361213684082,
      "pose_mae_dy": 0.03391068056225777,
      "pose_rmse_dtheta": 0.44006091356277466,
      "pose_rmse_dx": 0.22820180654525757,
      "pose_rmse_dy": 0.11165560036897659,
      "pose_rmse_mean": 0.25997278094291687,
      "rmse_dtheta": 0.048362407833337784,
      "rmse_dx": 0.022990131750702858,
      "rmse_dy": 0.012285514734685421,
      "rmse_mean": 0.02787935361266136,
      "rotation_flip": 0.00754310330376029,
      "sparse_tokens": 16212.0,
      "step": 3531,
      "turn_loss": 0.256273478269577,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1640958929566995,
      "grad_norm": 0.6085487604141235,
      "learning_rate": 8.100140178521625e-06,
      "loss": 0.1567,
      "mae_dtheta": 0.01281697303056717,
      "mae_dx": 0.002015072386711836,
      "mae_dy": 0.0023076303768903017,
      "pose_mae_dtheta": 0.0873311311006546,
      "pose_mae_dx": 0.02732907235622406,
      "pose_mae_dy": 0.03245741128921509,
      "pose_rmse_dtheta": 0.18244081735610962,
      "pose_rmse_dx": 0.06378599256277084,
      "pose_rmse_dy": 0.07037017494440079,
      "pose_rmse_mean": 0.10553233325481415,
      "rmse_dtheta": 0.02390122227370739,
      "rmse_dx": 0.006345812231302261,
      "rmse_dy": 0.004200304392725229,
      "rmse_mean": 0.01148244645446539,
      "rotation_flip": 0.0033738191705197096,
      "sparse_tokens": 32121.0,
      "step": 3532,
      "turn_loss": 0.09533704072237015,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.16414235272254227,
      "grad_norm": 0.5402950644493103,
      "learning_rate": 8.099102683907482e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.009896191768348217,
      "mae_dx": 0.0027404562570154667,
      "mae_dy": 0.0013602550607174635,
      "pose_mae_dtheta": 0.06978953629732132,
      "pose_mae_dx": 0.027301274240016937,
      "pose_mae_dy": 0.02119036763906479,
      "pose_rmse_dtheta": 0.2012110948562622,
      "pose_rmse_dx": 0.10170893371105194,
      "pose_rmse_dy": 0.05509154498577118,
      "pose_rmse_mean": 0.11933720111846924,
      "rmse_dtheta": 0.02438206411898136,
      "rmse_dx": 0.01071591954678297,
      "rmse_dy": 0.002934014657512307,
      "rmse_mean": 0.012677333317697048,
      "rotation_flip": 0.00873563252389431,
      "sparse_tokens": 32089.0,
      "step": 3533,
      "turn_loss": 0.11508149653673172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 43354.0,
      "epoch": 0.16418881248838507,
      "grad_norm": 0.490795761346817,
      "learning_rate": 8.098064972571424e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.038141004741191864,
      "mae_dx": 0.012854891829192638,
      "mae_dy": 0.004601853899657726,
      "pose_mae_dtheta": 0.3222556710243225,
      "pose_mae_dx": 0.11165336519479752,
      "pose_mae_dy": 0.05348354950547218,
      "pose_rmse_dtheta": 0.5268070101737976,
      "pose_rmse_dx": 0.23466236889362335,
      "pose_rmse_dy": 0.1284497082233429,
      "pose_rmse_mean": 0.29663968086242676,
      "rmse_dtheta": 0.055404238402843475,
      "rmse_dx": 0.02510380558669567,
      "rmse_dy": 0.008947434835135937,
      "rmse_mean": 0.029818493872880936,
      "rotation_flip": 0.012962962500751019,
      "sparse_tokens": 30154.0,
      "step": 3534,
      "turn_loss": 0.29505813121795654,
      "turns": 134.0,
      "turns_per_sample": 134.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.16423527225422785,
      "grad_norm": 0.49815937876701355,
      "learning_rate": 8.097027044586021e-06,
      "loss": 0.0992,
      "mae_dtheta": 0.00735038286074996,
      "mae_dx": 0.0012240108335390687,
      "mae_dy": 0.0013499173801392317,
      "pose_mae_dtheta": 0.04894036799669266,
      "pose_mae_dx": 0.014742635190486908,
      "pose_mae_dy": 0.021988797932863235,
      "pose_rmse_dtheta": 0.1367267668247223,
      "pose_rmse_dx": 0.03931231051683426,
      "pose_rmse_dy": 0.054612766951322556,
      "pose_rmse_mean": 0.0768839493393898,
      "rmse_dtheta": 0.019712306559085846,
      "rmse_dx": 0.004298210144042969,
      "rmse_dy": 0.003137379651889205,
      "rmse_mean": 0.00904929917305708,
      "rotation_flip": 0.0015839493134990335,
      "sparse_tokens": 32057.0,
      "step": 3535,
      "turn_loss": 0.061130501329898834,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.16428173202007063,
      "grad_norm": 0.3485580086708069,
      "learning_rate": 8.095988900023854e-06,
      "loss": 0.1281,
      "mae_dtheta": 0.008858081884682178,
      "mae_dx": 0.0016762054292485118,
      "mae_dy": 0.0017298957100138068,
      "pose_mae_dtheta": 0.06414088606834412,
      "pose_mae_dx": 0.0208809282630682,
      "pose_mae_dy": 0.02135610207915306,
      "pose_rmse_dtheta": 0.15995708107948303,
      "pose_rmse_dx": 0.042904727160930634,
      "pose_rmse_dy": 0.051066894084215164,
      "pose_rmse_mean": 0.0846429094672203,
      "rmse_dtheta": 0.01964869163930416,
      "rmse_dx": 0.004463565070182085,
      "rmse_dy": 0.0037127467803657055,
      "rmse_mean": 0.009275001473724842,
      "rotation_flip": 0.0016539860516786575,
      "sparse_tokens": 32201.0,
      "step": 3536,
      "turn_loss": 0.07019124925136566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22326.0,
      "epoch": 0.1643281917859134,
      "grad_norm": 0.38151589035987854,
      "learning_rate": 8.094950538957523e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.041864849627017975,
      "mae_dx": 0.012970834970474243,
      "mae_dy": 0.005673249717801809,
      "pose_mae_dtheta": 0.31685444712638855,
      "pose_mae_dx": 0.11021307855844498,
      "pose_mae_dy": 0.07129508256912231,
      "pose_rmse_dtheta": 0.5402709245681763,
      "pose_rmse_dx": 0.2271612137556076,
      "pose_rmse_dy": 0.16338033974170685,
      "pose_rmse_mean": 0.31027084589004517,
      "rmse_dtheta": 0.060213353484869,
      "rmse_dx": 0.025007663294672966,
      "rmse_dy": 0.010459351353347301,
      "rmse_mean": 0.03189345449209213,
      "rotation_flip": 0.014953271485865116,
      "sparse_tokens": 19228.0,
      "step": 3537,
      "turn_loss": 0.30987468361854553,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16437465155175618,
      "grad_norm": 0.4646746814250946,
      "learning_rate": 8.093911961459637e-06,
      "loss": 0.1234,
      "mae_dtheta": 0.012602566741406918,
      "mae_dx": 0.001983452355489135,
      "mae_dy": 0.0033349378500133753,
      "pose_mae_dtheta": 0.08176738768815994,
      "pose_mae_dx": 0.03174000233411789,
      "pose_mae_dy": 0.03718607872724533,
      "pose_rmse_dtheta": 0.19446612894535065,
      "pose_rmse_dx": 0.06874927878379822,
      "pose_rmse_dy": 0.08243663609027863,
      "pose_rmse_mean": 0.11521735042333603,
      "rmse_dtheta": 0.02523910067975521,
      "rmse_dx": 0.004801545292139053,
      "rmse_dy": 0.006673308555036783,
      "rmse_mean": 0.01223798468708992,
      "rotation_flip": 0.00826446246355772,
      "sparse_tokens": 32105.0,
      "step": 3538,
      "turn_loss": 0.12673422694206238,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.16442111131759896,
      "grad_norm": 0.46415725350379944,
      "learning_rate": 8.092873167602829e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.009086892940104008,
      "mae_dx": 0.002147905295714736,
      "mae_dy": 0.0025290781632065773,
      "pose_mae_dtheta": 0.05993540212512016,
      "pose_mae_dx": 0.02422444149851799,
      "pose_mae_dy": 0.021526243537664413,
      "pose_rmse_dtheta": 0.16317026317119598,
      "pose_rmse_dx": 0.08249970525503159,
      "pose_rmse_dy": 0.0744820237159729,
      "pose_rmse_mean": 0.10671733319759369,
      "rmse_dtheta": 0.022676359862089157,
      "rmse_dx": 0.006839445326477289,
      "rmse_dy": 0.008193201385438442,
      "rmse_mean": 0.0125696687027812,
      "rotation_flip": 0.004854368977248669,
      "sparse_tokens": 32153.0,
      "step": 3539,
      "turn_loss": 0.08726422488689423,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34713.0,
      "epoch": 0.16446757108344173,
      "grad_norm": 0.8120138645172119,
      "learning_rate": 8.09183415745974e-06,
      "loss": 0.2363,
      "mae_dtheta": 0.03692999482154846,
      "mae_dx": 0.013208831660449505,
      "mae_dy": 0.006035592406988144,
      "pose_mae_dtheta": 0.27929121255874634,
      "pose_mae_dx": 0.11149188131093979,
      "pose_mae_dy": 0.059788499027490616,
      "pose_rmse_dtheta": 0.46832939982414246,
      "pose_rmse_dx": 0.21762508153915405,
      "pose_rmse_dy": 0.15942144393920898,
      "pose_rmse_mean": 0.2817919850349426,
      "rmse_dtheta": 0.05433043837547302,
      "rmse_dx": 0.024657385423779488,
      "rmse_dy": 0.01331611629575491,
      "rmse_mean": 0.030767980962991714,
      "rotation_flip": 0.014573991298675537,
      "sparse_tokens": 28953.0,
      "step": 3540,
      "turn_loss": 0.32679635286331177,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1645140308492845,
      "grad_norm": 0.40759384632110596,
      "learning_rate": 8.090794931103026e-06,
      "loss": 0.0978,
      "mae_dtheta": 0.008663902059197426,
      "mae_dx": 0.0014300592010840774,
      "mae_dy": 0.001770779024809599,
      "pose_mae_dtheta": 0.06307853758335114,
      "pose_mae_dx": 0.02013697288930416,
      "pose_mae_dy": 0.028137337416410446,
      "pose_rmse_dtheta": 0.14123208820819855,
      "pose_rmse_dx": 0.04823446273803711,
      "pose_rmse_dy": 0.06875548511743546,
      "pose_rmse_mean": 0.08607401698827744,
      "rmse_dtheta": 0.01841472089290619,
      "rmse_dx": 0.004302272107452154,
      "rmse_dy": 0.003961973357945681,
      "rmse_mean": 0.008892988786101341,
      "rotation_flip": 0.0004152823821641505,
      "sparse_tokens": 32105.0,
      "step": 3541,
      "turn_loss": 0.07105081528425217,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.1645604906151273,
      "grad_norm": 0.45499905943870544,
      "learning_rate": 8.089755488605367e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.015385553240776062,
      "mae_dx": 0.002275781473144889,
      "mae_dy": 0.0015512221725657582,
      "pose_mae_dtheta": 0.10929848998785019,
      "pose_mae_dx": 0.021632924675941467,
      "pose_mae_dy": 0.022161681205034256,
      "pose_rmse_dtheta": 0.3090776801109314,
      "pose_rmse_dx": 0.05271542817354202,
      "pose_rmse_dy": 0.06515906751155853,
      "pose_rmse_mean": 0.14231739938259125,
      "rmse_dtheta": 0.03530506789684296,
      "rmse_dx": 0.007216670084744692,
      "rmse_dy": 0.003283565863966942,
      "rmse_mean": 0.015268435701727867,
      "rotation_flip": 0.001450326293706894,
      "sparse_tokens": 32185.0,
      "step": 3542,
      "turn_loss": 0.09984699636697769,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.1646069503809701,
      "grad_norm": 0.5284186005592346,
      "learning_rate": 8.088715830039446e-06,
      "loss": 0.1622,
      "mae_dtheta": 0.030419861897826195,
      "mae_dx": 0.01794523373246193,
      "mae_dy": 0.004887171555310488,
      "pose_mae_dtheta": 0.24149452149868011,
      "pose_mae_dx": 0.14733801782131195,
      "pose_mae_dy": 0.07394508272409439,
      "pose_rmse_dtheta": 0.3894411027431488,
      "pose_rmse_dx": 0.3093973398208618,
      "pose_rmse_dy": 0.15907257795333862,
      "pose_rmse_mean": 0.2859703600406647,
      "rmse_dtheta": 0.04311830550432205,
      "rmse_dx": 0.0315338559448719,
      "rmse_dy": 0.008505945093929768,
      "rmse_mean": 0.027719371020793915,
      "rotation_flip": 0.01715686358511448,
      "sparse_tokens": 7243.0,
      "step": 3543,
      "turn_loss": 0.29660746455192566,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.16465341014681287,
      "grad_norm": 0.942890465259552,
      "learning_rate": 8.087675955477971e-06,
      "loss": 0.2896,
      "mae_dtheta": 0.024889633059501648,
      "mae_dx": 0.0054879263043403625,
      "mae_dy": 0.0032037191558629274,
      "pose_mae_dtheta": 0.18123985826969147,
      "pose_mae_dx": 0.033848632127046585,
      "pose_mae_dy": 0.0438668467104435,
      "pose_rmse_dtheta": 0.31259000301361084,
      "pose_rmse_dx": 0.08201681822538376,
      "pose_rmse_dy": 0.09797587990760803,
      "pose_rmse_mean": 0.1641942411661148,
      "rmse_dtheta": 0.043789006769657135,
      "rmse_dx": 0.01271209865808487,
      "rmse_dy": 0.0064824591390788555,
      "rmse_mean": 0.02099452167749405,
      "rotation_flip": 0.010989011265337467,
      "sparse_tokens": 4946.0,
      "step": 3544,
      "turn_loss": 0.19126154482364655,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 1663.0,
      "epoch": 0.16469986991265564,
      "grad_norm": 0.48287343978881836,
      "learning_rate": 8.08663586499366e-06,
      "loss": 0.104,
      "mae_dtheta": 0.027080504223704338,
      "mae_dx": 0.03698650747537613,
      "mae_dy": 0.014220702461898327,
      "pose_mae_dtheta": 0.2104310393333435,
      "pose_mae_dx": 0.23597237467765808,
      "pose_mae_dy": 0.20376628637313843,
      "pose_rmse_dtheta": 0.27516260743141174,
      "pose_rmse_dx": 0.3906647264957428,
      "pose_rmse_dy": 0.3067295551300049,
      "pose_rmse_mean": 0.32418563961982727,
      "rmse_dtheta": 0.03656516224145889,
      "rmse_dx": 0.04879070073366165,
      "rmse_dy": 0.019344085827469826,
      "rmse_mean": 0.034899983555078506,
      "rotation_flip": 0.0,
      "sparse_tokens": 1467.0,
      "step": 3545,
      "turn_loss": 0.38939911127090454,
      "turns": 5.0,
      "turns_per_sample": 5.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.16474632967849842,
      "grad_norm": 0.5419586896896362,
      "learning_rate": 8.085595558659244e-06,
      "loss": 0.1286,
      "mae_dtheta": 0.012215523049235344,
      "mae_dx": 0.002699317643418908,
      "mae_dy": 0.0022797691635787487,
      "pose_mae_dtheta": 0.09465737640857697,
      "pose_mae_dx": 0.02894161269068718,
      "pose_mae_dy": 0.026532916352152824,
      "pose_rmse_dtheta": 0.2631145119667053,
      "pose_rmse_dx": 0.08274281769990921,
      "pose_rmse_dy": 0.0635988786816597,
      "pose_rmse_mean": 0.13648539781570435,
      "rmse_dtheta": 0.028798501938581467,
      "rmse_dx": 0.008105983957648277,
      "rmse_dy": 0.0059552560560405254,
      "rmse_mean": 0.014286580495536327,
      "rotation_flip": 0.007179896347224712,
      "sparse_tokens": 32121.0,
      "step": 3546,
      "turn_loss": 0.07818624377250671,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.1647927894443412,
      "grad_norm": 0.7567341923713684,
      "learning_rate": 8.084555036547475e-06,
      "loss": 0.1771,
      "mae_dtheta": 0.03284776955842972,
      "mae_dx": 0.010543424636125565,
      "mae_dy": 0.0045147971250116825,
      "pose_mae_dtheta": 0.23226222395896912,
      "pose_mae_dx": 0.08146029710769653,
      "pose_mae_dy": 0.058097999542951584,
      "pose_rmse_dtheta": 0.40309375524520874,
      "pose_rmse_dx": 0.1756795048713684,
      "pose_rmse_dy": 0.13697420060634613,
      "pose_rmse_mean": 0.23858249187469482,
      "rmse_dtheta": 0.052042681723833084,
      "rmse_dx": 0.02156316675245762,
      "rmse_dy": 0.009754403494298458,
      "rmse_mean": 0.027786752209067345,
      "rotation_flip": 0.008196720853447914,
      "sparse_tokens": 10193.0,
      "step": 3547,
      "turn_loss": 0.26225873827934265,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.16483924921018397,
      "grad_norm": 0.4476430118083954,
      "learning_rate": 8.083514298731117e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.012777147814631462,
      "mae_dx": 0.004689929075539112,
      "mae_dy": 0.0032702521421015263,
      "pose_mae_dtheta": 0.10203537344932556,
      "pose_mae_dx": 0.04464694485068321,
      "pose_mae_dy": 0.03745141997933388,
      "pose_rmse_dtheta": 0.25178974866867065,
      "pose_rmse_dx": 0.13452284038066864,
      "pose_rmse_dy": 0.10949156433343887,
      "pose_rmse_mean": 0.16526806354522705,
      "rmse_dtheta": 0.02734505385160446,
      "rmse_dx": 0.013821725733578205,
      "rmse_dy": 0.007733295205980539,
      "rmse_mean": 0.016300026327371597,
      "rotation_flip": 0.005376344081014395,
      "sparse_tokens": 32089.0,
      "step": 3548,
      "turn_loss": 0.11856929957866669,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18773.0,
      "epoch": 0.16488570897602675,
      "grad_norm": 0.6199314594268799,
      "learning_rate": 8.082473345282949e-06,
      "loss": 0.1455,
      "mae_dtheta": 0.03582228720188141,
      "mae_dx": 0.014569476246833801,
      "mae_dy": 0.004856054205447435,
      "pose_mae_dtheta": 0.2922404706478119,
      "pose_mae_dx": 0.11604099720716476,
      "pose_mae_dy": 0.07074235379695892,
      "pose_rmse_dtheta": 0.5158863663673401,
      "pose_rmse_dx": 0.25427788496017456,
      "pose_rmse_dy": 0.1628354787826538,
      "pose_rmse_mean": 0.31099992990493774,
      "rmse_dtheta": 0.05509809032082558,
      "rmse_dx": 0.027487387880682945,
      "rmse_dy": 0.008787527680397034,
      "rmse_mean": 0.030457668006420135,
      "rotation_flip": 0.01662404090166092,
      "sparse_tokens": 15249.0,
      "step": 3549,
      "turn_loss": 0.20192112028598785,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16493216874186953,
      "grad_norm": 0.6053099036216736,
      "learning_rate": 8.081432176275765e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.008728248998522758,
      "mae_dx": 0.0014245078200474381,
      "mae_dy": 0.0014983261935412884,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6053097248077393,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.69581604003906,
      "model/head/act_norm_mean": 123.19392163825758,
      "model/head/act_norm_min": 73.46124267578125,
      "model/head/act_over_embed": 84.66001630947646,
      "model/head/grad_frac": 0.11359929293394089,
      "model/head/grad_norm": 0.06876275688409805,
      "model/head/grad_zero_frac": 0.00015260772488545626,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6916183317550505,
      "model/head/update_ratio": 0.0011838208884000778,
      "model/head/weight_delta": 7.023358345031738,
      "model/head/weight_delta_rel": 0.12321051210165024,
      "model/head/weight_norm": 58.08544158935547,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4169805645942688,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41689666611196746,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4168317914009094,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2864952920002257,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07660552859306335,
      "model/modality_embedder.encoders.pose/grad_norm": 0.046370070427656174,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.519321048206278,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015029663918539882,
      "model/modality_embedder.encoders.pose/weight_delta": 2.3032174110412598,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07525329291820526,
      "model/modality_embedder.encoders.pose/weight_norm": 30.852367401123047,
      "model/modality_embedder/grad_frac": 0.07660552859306335,
      "model/modality_embedder/grad_norm": 0.046370070427656174,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.519321048206278,
      "model/modality_embedder/update_ratio": 0.0015029663918539882,
      "model/modality_embedder/weight_delta": 2.3032174110412598,
      "model/modality_embedder/weight_delta_rel": 0.07525329291820526,
      "model/modality_embedder/weight_norm": 30.852367401123047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.26265716552734,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.810806477473143,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.046934127807617,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.050218493749455,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08677629381418228,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05252653360366821,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018950124504044652,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.5986357927322388,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05825525149703026,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.718305587768555,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.49913787841797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.86717372134039,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.188987731933594,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.77616395360098,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0758892148733139,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04593648016452789,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015643873484805226,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.018557071685791,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.06992439180612564,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.36387825012207,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.01702880859375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.79470548741382,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 11.946353912353516,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.100781829083356,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06813637912273407,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04124361276626587,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001360624679364264,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.163437843322754,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0726441890001297,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.31226348876953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.9089126586914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.60123556998557,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.533758163452148,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.34224621482776,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07063380628824234,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.042755331844091415,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014424585970118642,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.8462722301483154,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06309682130813599,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.640596389770508,
      "model/normalizer/grad_frac": 0.2826615869998932,
      "model/normalizer/grad_norm": 0.17109781503677368,
      "model/normalizer/grad_zero_frac": 0.00018080597510561347,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021878755651414394,
      "model/normalizer/weight_delta": 3.9269566535949707,
      "model/normalizer/weight_delta_rel": 0.05057692900300026,
      "model/normalizer/weight_norm": 78.20272064208984,
      "pose_mae_dtheta": 0.061853330582380295,
      "pose_mae_dx": 0.016622299328446388,
      "pose_mae_dy": 0.018838969990611076,
      "pose_rmse_dtheta": 0.17743323743343353,
      "pose_rmse_dx": 0.04163701832294464,
      "pose_rmse_dy": 0.04484715685248375,
      "pose_rmse_mean": 0.0879724770784378,
      "rmse_dtheta": 0.022844841703772545,
      "rmse_dx": 0.003998763393610716,
      "rmse_dy": 0.0033689294941723347,
      "rmse_mean": 0.010070845484733582,
      "rotation_flip": 0.002263467526063323,
      "sparse_tokens": 32105.0,
      "step": 3550,
      "turn_loss": 0.062021881341934204,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.16497862850771233,
      "grad_norm": 0.5942707657814026,
      "learning_rate": 8.080390791782375e-06,
      "loss": 0.1641,
      "mae_dtheta": 0.03574509918689728,
      "mae_dx": 0.016393255442380905,
      "mae_dy": 0.0071862307377159595,
      "pose_mae_dtheta": 0.2955564260482788,
      "pose_mae_dx": 0.12407389283180237,
      "pose_mae_dy": 0.09691272675991058,
      "pose_rmse_dtheta": 0.5007786750793457,
      "pose_rmse_dx": 0.2575136721134186,
      "pose_rmse_dy": 0.1751563996076584,
      "pose_rmse_mean": 0.31114959716796875,
      "rmse_dtheta": 0.05154632776975632,
      "rmse_dx": 0.029233353212475777,
      "rmse_dy": 0.011889017187058926,
      "rmse_mean": 0.030889566987752914,
      "rotation_flip": 0.009009009227156639,
      "sparse_tokens": 11258.0,
      "step": 3551,
      "turn_loss": 0.3480033576488495,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.1650250882735551,
      "grad_norm": 0.48596784472465515,
      "learning_rate": 8.079349191875605e-06,
      "loss": 0.1375,
      "mae_dtheta": 0.04292234033346176,
      "mae_dx": 0.012368783354759216,
      "mae_dy": 0.004896316211670637,
      "pose_mae_dtheta": 0.34507137537002563,
      "pose_mae_dx": 0.09075368940830231,
      "pose_mae_dy": 0.07247396558523178,
      "pose_rmse_dtheta": 0.5567727088928223,
      "pose_rmse_dx": 0.1844814419746399,
      "pose_rmse_dy": 0.1728000044822693,
      "pose_rmse_mean": 0.30468472838401794,
      "rmse_dtheta": 0.05930569767951965,
      "rmse_dx": 0.023488741368055344,
      "rmse_dy": 0.010123325511813164,
      "rmse_mean": 0.030972590669989586,
      "rotation_flip": 0.014556040987372398,
      "sparse_tokens": 10985.0,
      "step": 3552,
      "turn_loss": 0.3093298077583313,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1650715480393979,
      "grad_norm": 0.5870411396026611,
      "learning_rate": 8.078307376628292e-06,
      "loss": 0.1106,
      "mae_dtheta": 0.018978890031576157,
      "mae_dx": 0.005906425416469574,
      "mae_dy": 0.007408465258777142,
      "pose_mae_dtheta": 0.13452652096748352,
      "pose_mae_dx": 0.07910829037427902,
      "pose_mae_dy": 0.06646452844142914,
      "pose_rmse_dtheta": 0.29860568046569824,
      "pose_rmse_dx": 0.20220349729061127,
      "pose_rmse_dy": 0.1568896621465683,
      "pose_rmse_mean": 0.2192329615354538,
      "rmse_dtheta": 0.035123612731695175,
      "rmse_dx": 0.014446605928242207,
      "rmse_dy": 0.01534352544695139,
      "rmse_mean": 0.021637914702296257,
      "rotation_flip": 0.011064593680202961,
      "sparse_tokens": 32089.0,
      "step": 3553,
      "turn_loss": 0.22227253019809723,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.16511800780524066,
      "grad_norm": 0.5620810985565186,
      "learning_rate": 8.077265346113292e-06,
      "loss": 0.1287,
      "mae_dtheta": 0.037425436079502106,
      "mae_dx": 0.009114550426602364,
      "mae_dy": 0.005246235057711601,
      "pose_mae_dtheta": 0.30067959427833557,
      "pose_mae_dx": 0.07158605754375458,
      "pose_mae_dy": 0.04627053439617157,
      "pose_rmse_dtheta": 0.566643238067627,
      "pose_rmse_dx": 0.16416041553020477,
      "pose_rmse_dy": 0.09857670217752457,
      "pose_rmse_mean": 0.2764601409435272,
      "rmse_dtheta": 0.057495247572660446,
      "rmse_dx": 0.019901733845472336,
      "rmse_dy": 0.00926105584949255,
      "rmse_mean": 0.028886012732982635,
      "rotation_flip": 0.009493670426309109,
      "sparse_tokens": 6034.0,
      "step": 3554,
      "turn_loss": 0.2571299374103546,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.16516446757108344,
      "grad_norm": 0.5628364682197571,
      "learning_rate": 8.076223100403476e-06,
      "loss": 0.1121,
      "mae_dtheta": 0.014661029912531376,
      "mae_dx": 0.0035973326303064823,
      "mae_dy": 0.003615511115640402,
      "pose_mae_dtheta": 0.10545726120471954,
      "pose_mae_dx": 0.04171968996524811,
      "pose_mae_dy": 0.03748132660984993,
      "pose_rmse_dtheta": 0.24902021884918213,
      "pose_rmse_dx": 0.11918367445468903,
      "pose_rmse_dy": 0.10759775340557098,
      "pose_rmse_mean": 0.1586005538702011,
      "rmse_dtheta": 0.03143486753106117,
      "rmse_dx": 0.009482751600444317,
      "rmse_dy": 0.009228525683283806,
      "rmse_mean": 0.016715383157134056,
      "rotation_flip": 0.008089368231594563,
      "sparse_tokens": 32137.0,
      "step": 3555,
      "turn_loss": 0.1639183908700943,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16521092733692622,
      "grad_norm": 0.35694634914398193,
      "learning_rate": 8.075180639571726e-06,
      "loss": 0.105,
      "mae_dtheta": 0.008267180062830448,
      "mae_dx": 0.002202129689976573,
      "mae_dy": 0.0012288903817534447,
      "pose_mae_dtheta": 0.055763717740774155,
      "pose_mae_dx": 0.02257191203534603,
      "pose_mae_dy": 0.016413787379860878,
      "pose_rmse_dtheta": 0.1661606878042221,
      "pose_rmse_dx": 0.0632559284567833,
      "pose_rmse_dy": 0.04354207590222359,
      "pose_rmse_mean": 0.0909862369298935,
      "rmse_dtheta": 0.02233138680458069,
      "rmse_dx": 0.007221865933388472,
      "rmse_dy": 0.003000133903697133,
      "rmse_mean": 0.010851128958165646,
      "rotation_flip": 0.00650406489148736,
      "sparse_tokens": 32105.0,
      "step": 3556,
      "turn_loss": 0.05620941147208214,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.165257387102769,
      "grad_norm": 0.5602342486381531,
      "learning_rate": 8.074137963690943e-06,
      "loss": 0.1713,
      "mae_dtheta": 0.004971247166395187,
      "mae_dx": 0.0011765240924432874,
      "mae_dy": 0.0012589078396558762,
      "pose_mae_dtheta": 0.038021646440029144,
      "pose_mae_dx": 0.013926330953836441,
      "pose_mae_dy": 0.01575610041618347,
      "pose_rmse_dtheta": 0.0871100053191185,
      "pose_rmse_dx": 0.042061176151037216,
      "pose_rmse_dy": 0.04758954420685768,
      "pose_rmse_mean": 0.0589202418923378,
      "rmse_dtheta": 0.012058303691446781,
      "rmse_dx": 0.0036219016183167696,
      "rmse_dy": 0.003823039121925831,
      "rmse_mean": 0.006501081399619579,
      "rotation_flip": 0.0036307054106146097,
      "sparse_tokens": 32105.0,
      "step": 3557,
      "turn_loss": 0.047833383083343506,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.16530384686861177,
      "grad_norm": 0.5090140700340271,
      "learning_rate": 8.073095072834043e-06,
      "loss": 0.1229,
      "mae_dtheta": 0.011023134924471378,
      "mae_dx": 0.0014321121852844954,
      "mae_dy": 0.0022719157859683037,
      "pose_mae_dtheta": 0.0763075202703476,
      "pose_mae_dx": 0.02180962637066841,
      "pose_mae_dy": 0.029916955158114433,
      "pose_rmse_dtheta": 0.1881779432296753,
      "pose_rmse_dx": 0.05995573103427887,
      "pose_rmse_dy": 0.06980012357234955,
      "pose_rmse_mean": 0.10597793757915497,
      "rmse_dtheta": 0.023994583636522293,
      "rmse_dx": 0.004596525337547064,
      "rmse_dy": 0.0053281658329069614,
      "rmse_mean": 0.01130642555654049,
      "rotation_flip": 0.00319488812237978,
      "sparse_tokens": 32089.0,
      "step": 3558,
      "turn_loss": 0.0798773244023323,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 38818.0,
      "epoch": 0.16535030663445457,
      "grad_norm": 0.5395177602767944,
      "learning_rate": 8.072051967073955e-06,
      "loss": 0.2037,
      "mae_dtheta": 0.03489958122372627,
      "mae_dx": 0.013775749132037163,
      "mae_dy": 0.005079492926597595,
      "pose_mae_dtheta": 0.27497291564941406,
      "pose_mae_dx": 0.11486437916755676,
      "pose_mae_dy": 0.06196041777729988,
      "pose_rmse_dtheta": 0.4953679144382477,
      "pose_rmse_dx": 0.2591269314289093,
      "pose_rmse_dy": 0.17660754919052124,
      "pose_rmse_mean": 0.3103674650192261,
      "rmse_dtheta": 0.05420605465769768,
      "rmse_dx": 0.027387021109461784,
      "rmse_dy": 0.013081127777695656,
      "rmse_mean": 0.031558066606521606,
      "rotation_flip": 0.010582010261714458,
      "sparse_tokens": 29818.0,
      "step": 3559,
      "turn_loss": 0.3261541426181793,
      "turns": 120.0,
      "turns_per_sample": 120.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.16539676640029735,
      "grad_norm": 0.5900822281837463,
      "learning_rate": 8.071008646483624e-06,
      "loss": 0.1773,
      "mae_dtheta": 0.03867147117853165,
      "mae_dx": 0.013601633720099926,
      "mae_dy": 0.005153629928827286,
      "pose_mae_dtheta": 0.3169545829296112,
      "pose_mae_dx": 0.10698262602090836,
      "pose_mae_dy": 0.06771194189786911,
      "pose_rmse_dtheta": 0.5414044260978699,
      "pose_rmse_dx": 0.22954298555850983,
      "pose_rmse_dy": 0.1629851758480072,
      "pose_rmse_mean": 0.31131085753440857,
      "rmse_dtheta": 0.05678607523441315,
      "rmse_dx": 0.026940137147903442,
      "rmse_dy": 0.0101566631346941,
      "rmse_mean": 0.03129429370164871,
      "rotation_flip": 0.013930348679423332,
      "sparse_tokens": 16249.0,
      "step": 3560,
      "turn_loss": 0.3289087116718292,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 26931.0,
      "epoch": 0.16544322616614013,
      "grad_norm": 0.8952196836471558,
      "learning_rate": 8.06996511113601e-06,
      "loss": 0.287,
      "mae_dtheta": 0.030256444588303566,
      "mae_dx": 0.012118911370635033,
      "mae_dy": 0.0061460211873054504,
      "pose_mae_dtheta": 0.23308461904525757,
      "pose_mae_dx": 0.09780263900756836,
      "pose_mae_dy": 0.08239265531301498,
      "pose_rmse_dtheta": 0.44873863458633423,
      "pose_rmse_dx": 0.21239984035491943,
      "pose_rmse_dy": 0.18490555882453918,
      "pose_rmse_mean": 0.2820146977901459,
      "rmse_dtheta": 0.0499010868370533,
      "rmse_dx": 0.02491615153849125,
      "rmse_dy": 0.013217100873589516,
      "rmse_mean": 0.02934478037059307,
      "rotation_flip": 0.012264922261238098,
      "sparse_tokens": 19956.0,
      "step": 3561,
      "turn_loss": 0.24759262800216675,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 12638.0,
      "epoch": 0.1654896859319829,
      "grad_norm": 0.485087126493454,
      "learning_rate": 8.06892136110409e-06,
      "loss": 0.098,
      "mae_dtheta": 0.029055405408143997,
      "mae_dx": 0.011014040559530258,
      "mae_dy": 0.004025525879114866,
      "pose_mae_dtheta": 0.22107186913490295,
      "pose_mae_dx": 0.08356509357690811,
      "pose_mae_dy": 0.044784821569919586,
      "pose_rmse_dtheta": 0.36874446272850037,
      "pose_rmse_dx": 0.18608511984348297,
      "pose_rmse_dy": 0.1274494081735611,
      "pose_rmse_mean": 0.22742633521556854,
      "rmse_dtheta": 0.04445906728506088,
      "rmse_dx": 0.022178860381245613,
      "rmse_dy": 0.008607671596109867,
      "rmse_mean": 0.02508186548948288,
      "rotation_flip": 0.021052632480859756,
      "sparse_tokens": 9741.0,
      "step": 3562,
      "turn_loss": 0.22152502834796906,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.16553614569782568,
      "grad_norm": 0.7076265811920166,
      "learning_rate": 8.067877396460849e-06,
      "loss": 0.1533,
      "mae_dtheta": 0.011873260140419006,
      "mae_dx": 0.001854833448305726,
      "mae_dy": 0.003059069160372019,
      "pose_mae_dtheta": 0.08120328187942505,
      "pose_mae_dx": 0.02651023678481579,
      "pose_mae_dy": 0.03342003375291824,
      "pose_rmse_dtheta": 0.17243176698684692,
      "pose_rmse_dx": 0.05734822899103165,
      "pose_rmse_dy": 0.06958375126123428,
      "pose_rmse_mean": 0.09978791326284409,
      "rmse_dtheta": 0.02393949218094349,
      "rmse_dx": 0.004954345058649778,
      "rmse_dy": 0.005706751719117165,
      "rmse_mean": 0.011533530429005623,
      "rotation_flip": 0.005110188387334347,
      "sparse_tokens": 32121.0,
      "step": 3563,
      "turn_loss": 0.0903705433011055,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.16558260546366846,
      "grad_norm": 0.9579062461853027,
      "learning_rate": 8.066833217279297e-06,
      "loss": 0.1782,
      "mae_dtheta": 0.014788615517318249,
      "mae_dx": 0.003547453321516514,
      "mae_dy": 0.0029552108608186245,
      "pose_mae_dtheta": 0.10301478952169418,
      "pose_mae_dx": 0.03412562981247902,
      "pose_mae_dy": 0.029591206461191177,
      "pose_rmse_dtheta": 0.25031614303588867,
      "pose_rmse_dx": 0.0757211372256279,
      "pose_rmse_dy": 0.06293131411075592,
      "pose_rmse_mean": 0.12965619564056396,
      "rmse_dtheta": 0.031185610219836235,
      "rmse_dx": 0.009158405475318432,
      "rmse_dy": 0.007104004733264446,
      "rmse_mean": 0.015816006809473038,
      "rotation_flip": 0.004287245217710733,
      "sparse_tokens": 32153.0,
      "step": 3564,
      "turn_loss": 0.1303563416004181,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.16562906522951124,
      "grad_norm": 0.6030370593070984,
      "learning_rate": 8.065788823632451e-06,
      "loss": 0.142,
      "mae_dtheta": 0.04025591164827347,
      "mae_dx": 0.009068187326192856,
      "mae_dy": 0.0023361686617136,
      "pose_mae_dtheta": 0.3634983003139496,
      "pose_mae_dx": 0.053018707782030106,
      "pose_mae_dy": 0.046874746680259705,
      "pose_rmse_dtheta": 0.6310397386550903,
      "pose_rmse_dx": 0.13703301548957825,
      "pose_rmse_dy": 0.10337729752063751,
      "pose_rmse_mean": 0.29048335552215576,
      "rmse_dtheta": 0.059817664325237274,
      "rmse_dx": 0.019803350791335106,
      "rmse_dy": 0.0038170763291418552,
      "rmse_mean": 0.027812696993350983,
      "rotation_flip": 0.03361344709992409,
      "sparse_tokens": 2225.0,
      "step": 3565,
      "turn_loss": 0.21836021542549133,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.165675524995354,
      "grad_norm": 0.5459666848182678,
      "learning_rate": 8.064744215593346e-06,
      "loss": 0.1214,
      "mae_dtheta": 0.008993914350867271,
      "mae_dx": 0.0018760192906484008,
      "mae_dy": 0.002187781734392047,
      "pose_mae_dtheta": 0.06469473242759705,
      "pose_mae_dx": 0.021249262616038322,
      "pose_mae_dy": 0.027729839086532593,
      "pose_rmse_dtheta": 0.16733640432357788,
      "pose_rmse_dx": 0.05400717630982399,
      "pose_rmse_dy": 0.05659758672118187,
      "pose_rmse_mean": 0.09264706075191498,
      "rmse_dtheta": 0.01872439496219158,
      "rmse_dx": 0.005983526352792978,
      "rmse_dy": 0.004423009697347879,
      "rmse_mean": 0.009710310027003288,
      "rotation_flip": 0.002439874457195401,
      "sparse_tokens": 32121.0,
      "step": 3566,
      "turn_loss": 0.07242994755506516,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.16572198476119682,
      "grad_norm": 0.5431253910064697,
      "learning_rate": 8.063699393235035e-06,
      "loss": 0.1549,
      "mae_dtheta": 0.026608537882566452,
      "mae_dx": 0.008880232460796833,
      "mae_dy": 0.0035366297233849764,
      "pose_mae_dtheta": 0.18305088579654694,
      "pose_mae_dx": 0.06753634661436081,
      "pose_mae_dy": 0.03711768612265587,
      "pose_rmse_dtheta": 0.34854915738105774,
      "pose_rmse_dx": 0.17410409450531006,
      "pose_rmse_dy": 0.07744187116622925,
      "pose_rmse_mean": 0.20003169775009155,
      "rmse_dtheta": 0.04313620552420616,
      "rmse_dx": 0.02013385109603405,
      "rmse_dy": 0.006653068587183952,
      "rmse_mean": 0.023307709023356438,
      "rotation_flip": 0.011862396262586117,
      "sparse_tokens": 15050.0,
      "step": 3567,
      "turn_loss": 0.19106362760066986,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1657684445270396,
      "grad_norm": 0.49602386355400085,
      "learning_rate": 8.06265435663058e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.010351579636335373,
      "mae_dx": 0.0016475504962727427,
      "mae_dy": 0.0019382907776162028,
      "pose_mae_dtheta": 0.07320878654718399,
      "pose_mae_dx": 0.02205641195178032,
      "pose_mae_dy": 0.024904020130634308,
      "pose_rmse_dtheta": 0.21038074791431427,
      "pose_rmse_dx": 0.06662622094154358,
      "pose_rmse_dy": 0.06336572766304016,
      "pose_rmse_mean": 0.1134575754404068,
      "rmse_dtheta": 0.02601352520287037,
      "rmse_dx": 0.004829687532037497,
      "rmse_dy": 0.005147923249751329,
      "rmse_mean": 0.011997045949101448,
      "rotation_flip": 0.006545114330947399,
      "sparse_tokens": 32105.0,
      "step": 3568,
      "turn_loss": 0.07854248583316803,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.16581490429288237,
      "grad_norm": 0.5971989631652832,
      "learning_rate": 8.061609105853062e-06,
      "loss": 0.1226,
      "mae_dtheta": 0.008471197448670864,
      "mae_dx": 0.0016265539452433586,
      "mae_dy": 0.0017646508058533072,
      "pose_mae_dtheta": 0.05667990818619728,
      "pose_mae_dx": 0.020132604986429214,
      "pose_mae_dy": 0.022355318069458008,
      "pose_rmse_dtheta": 0.14596964418888092,
      "pose_rmse_dx": 0.05260352045297623,
      "pose_rmse_dy": 0.053935613483190536,
      "pose_rmse_mean": 0.08416959643363953,
      "rmse_dtheta": 0.01987316831946373,
      "rmse_dx": 0.0050926366820931435,
      "rmse_dy": 0.0039046471938490868,
      "rmse_mean": 0.009623484686017036,
      "rotation_flip": 0.009409751743078232,
      "sparse_tokens": 32121.0,
      "step": 3569,
      "turn_loss": 0.068325936794281,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.16586136405872515,
      "grad_norm": 0.5284554958343506,
      "learning_rate": 8.060563640975577e-06,
      "loss": 0.19,
      "mae_dtheta": 0.039199188351631165,
      "mae_dx": 0.008098208345472813,
      "mae_dy": 0.0020876131020486355,
      "pose_mae_dtheta": 0.3197786211967468,
      "pose_mae_dx": 0.07285033166408539,
      "pose_mae_dy": 0.022265788167715073,
      "pose_rmse_dtheta": 0.5332220196723938,
      "pose_rmse_dx": 0.18456019461154938,
      "pose_rmse_dy": 0.053635913878679276,
      "pose_rmse_mean": 0.2571393847465515,
      "rmse_dtheta": 0.05638163909316063,
      "rmse_dx": 0.018802233040332794,
      "rmse_dy": 0.004294864367693663,
      "rmse_mean": 0.02649291232228279,
      "rotation_flip": 0.011945392936468124,
      "sparse_tokens": 10187.0,
      "step": 3570,
      "turn_loss": 0.273099809885025,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.16590782382456792,
      "grad_norm": 0.8833271265029907,
      "learning_rate": 8.059517962071234e-06,
      "loss": 0.3322,
      "mae_dtheta": 0.035985514521598816,
      "mae_dx": 0.013951480388641357,
      "mae_dy": 0.006777739617973566,
      "pose_mae_dtheta": 0.2990197241306305,
      "pose_mae_dx": 0.13164150714874268,
      "pose_mae_dy": 0.0667911022901535,
      "pose_rmse_dtheta": 0.4379737675189972,
      "pose_rmse_dx": 0.22142602503299713,
      "pose_rmse_dy": 0.12473282217979431,
      "pose_rmse_mean": 0.2613775432109833,
      "rmse_dtheta": 0.049695324152708054,
      "rmse_dx": 0.025092612951993942,
      "rmse_dy": 0.011768091470003128,
      "rmse_mean": 0.028852012008428574,
      "rotation_flip": 0.01610017940402031,
      "sparse_tokens": 9214.0,
      "step": 3571,
      "turn_loss": 0.4118046462535858,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.1659542835904107,
      "grad_norm": 0.5779315233230591,
      "learning_rate": 8.058472069213157e-06,
      "loss": 0.1795,
      "mae_dtheta": 0.04153860732913017,
      "mae_dx": 0.009951451793313026,
      "mae_dy": 0.007849939167499542,
      "pose_mae_dtheta": 0.3029603958129883,
      "pose_mae_dx": 0.0910157635807991,
      "pose_mae_dy": 0.07189493626356125,
      "pose_rmse_dtheta": 0.5217269659042358,
      "pose_rmse_dx": 0.19786494970321655,
      "pose_rmse_dy": 0.1481664478778839,
      "pose_rmse_mean": 0.2892528176307678,
      "rmse_dtheta": 0.05948932468891144,
      "rmse_dx": 0.021397899836301804,
      "rmse_dy": 0.015580542385578156,
      "rmse_mean": 0.032155923545360565,
      "rotation_flip": 0.014084506779909134,
      "sparse_tokens": 14809.0,
      "step": 3572,
      "turn_loss": 0.3992580473423004,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.16600074335625348,
      "grad_norm": 0.4832131266593933,
      "learning_rate": 8.057425962474485e-06,
      "loss": 0.0934,
      "mae_dtheta": 0.01161202136427164,
      "mae_dx": 0.0020710050594061613,
      "mae_dy": 0.0028080539777874947,
      "pose_mae_dtheta": 0.07785145193338394,
      "pose_mae_dx": 0.025739941745996475,
      "pose_mae_dy": 0.029907656833529472,
      "pose_rmse_dtheta": 0.2052210569381714,
      "pose_rmse_dx": 0.061016589403152466,
      "pose_rmse_dy": 0.0638158917427063,
      "pose_rmse_mean": 0.11001785099506378,
      "rmse_dtheta": 0.024482494220137596,
      "rmse_dx": 0.0055538807064294815,
      "rmse_dy": 0.005637922324240208,
      "rmse_mean": 0.011891432106494904,
      "rotation_flip": 0.00413365475833416,
      "sparse_tokens": 32137.0,
      "step": 3573,
      "turn_loss": 0.1041746437549591,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.16604720312209625,
      "grad_norm": 0.44324561953544617,
      "learning_rate": 8.056379641928378e-06,
      "loss": 0.1849,
      "mae_dtheta": 0.03490052372217178,
      "mae_dx": 0.011057903058826923,
      "mae_dy": 0.0074331872165203094,
      "pose_mae_dtheta": 0.25257155299186707,
      "pose_mae_dx": 0.08551178872585297,
      "pose_mae_dy": 0.09030183404684067,
      "pose_rmse_dtheta": 0.46787920594215393,
      "pose_rmse_dx": 0.18001919984817505,
      "pose_rmse_dy": 0.21439984440803528,
      "pose_rmse_mean": 0.2874327600002289,
      "rmse_dtheta": 0.05306915193796158,
      "rmse_dx": 0.022620387375354767,
      "rmse_dy": 0.013588511385023594,
      "rmse_mean": 0.029759351164102554,
      "rotation_flip": 0.01515151560306549,
      "sparse_tokens": 19633.0,
      "step": 3574,
      "turn_loss": 0.28919029235839844,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.16609366288793906,
      "grad_norm": 0.472646564245224,
      "learning_rate": 8.055333107648e-06,
      "loss": 0.0931,
      "mae_dtheta": 0.026420772075653076,
      "mae_dx": 0.009929260239005089,
      "mae_dy": 0.0038607025053352118,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.472646564245224,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 148.3592071533203,
      "model/head/act_norm_mean": 115.31324181189903,
      "model/head/act_norm_min": 68.59961700439453,
      "model/head/act_over_embed": 79.24433935271591,
      "model/head/grad_frac": 0.10830827802419662,
      "model/head/grad_norm": 0.0511915348470211,
      "model/head/grad_zero_frac": 0.00019036306184716523,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6837252103365384,
      "model/head/update_ratio": 0.0008812249870970845,
      "model/head/weight_delta": 7.045790195465088,
      "model/head/weight_delta_rel": 0.12360402941703796,
      "model/head/weight_norm": 58.09133529663086,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41697797179222107,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4168920337029223,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4168235957622528,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2864921085653606,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10432395339012146,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04930835962295532,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5249484080188679,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015981451142579317,
      "model/modality_embedder.encoders.pose/weight_delta": 2.3095717430114746,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07546091079711914,
      "model/modality_embedder.encoders.pose/weight_norm": 30.853492736816406,
      "model/modality_embedder/grad_frac": 0.10432395339012146,
      "model/modality_embedder/grad_norm": 0.04930835962295532,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5249484080188679,
      "model/modality_embedder/update_ratio": 0.0015981451142579317,
      "model/modality_embedder/weight_delta": 2.3095717430114746,
      "model/modality_embedder/weight_delta_rel": 0.07546091079711914,
      "model/modality_embedder/weight_norm": 30.853492736816406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.54215240478516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.95602010836386,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.89603042602539,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.462801298261486,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08641982823610306,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04084603488445282,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014735317090526223,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.6075961589813232,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.058581773191690445,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.719820022583008,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.04894256591797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.841739640567766,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.66552448272705,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.071476053028917,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07910028100013733,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03738647699356079,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012730568414554,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.030128240585327,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07032522559165955,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.367483139038086,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.86347961425781,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.53189388736264,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.073602676391602,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.232965874899715,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08641470968723297,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04084361717104912,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013472911668941379,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.1754941940307617,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07304902374744415,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.31536102294922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.67341613769531,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.448217147435898,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.16407299041748,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.549881160123082,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11574634164571762,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.054707109928131104,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018454666715115309,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.8571430444717407,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.063468337059021,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.644052505493164,
      "model/normalizer/grad_frac": 0.4208507537841797,
      "model/normalizer/grad_norm": 0.19891366362571716,
      "model/normalizer/grad_zero_frac": 0.00017489728634245694,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0025434503331780434,
      "model/normalizer/weight_delta": 3.9491899013519287,
      "model/normalizer/weight_delta_rel": 0.05086328089237213,
      "model/normalizer/weight_norm": 78.20623016357422,
      "pose_mae_dtheta": 0.19384987652301788,
      "pose_mae_dx": 0.07573158293962479,
      "pose_mae_dy": 0.034534722566604614,
      "pose_rmse_dtheta": 0.4102958142757416,
      "pose_rmse_dx": 0.1974014788866043,
      "pose_rmse_dy": 0.08767580986022949,
      "pose_rmse_mean": 0.23179104924201965,
      "rmse_dtheta": 0.0460616759955883,
      "rmse_dx": 0.022003987804055214,
      "rmse_dy": 0.008519694209098816,
      "rmse_mean": 0.025528453290462494,
      "rotation_flip": 0.014362657442688942,
      "sparse_tokens": 14190.0,
      "step": 3575,
      "turn_loss": 0.17804478108882904,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.16614012265378184,
      "grad_norm": 0.5916213989257812,
      "learning_rate": 8.054286359706538e-06,
      "loss": 0.1215,
      "mae_dtheta": 0.03090483322739601,
      "mae_dx": 0.008357967250049114,
      "mae_dy": 0.005099161062389612,
      "pose_mae_dtheta": 0.2573622167110443,
      "pose_mae_dx": 0.06712557375431061,
      "pose_mae_dy": 0.06179985776543617,
      "pose_rmse_dtheta": 0.4950283169746399,
      "pose_rmse_dx": 0.15532003343105316,
      "pose_rmse_dy": 0.17955704033374786,
      "pose_rmse_mean": 0.27663514018058777,
      "rmse_dtheta": 0.050941627472639084,
      "rmse_dx": 0.01886235550045967,
      "rmse_dy": 0.010053683072328568,
      "rmse_mean": 0.02661922201514244,
      "rotation_flip": 0.015837104991078377,
      "sparse_tokens": 16220.0,
      "step": 3576,
      "turn_loss": 0.23325638473033905,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1661865824196246,
      "grad_norm": 0.5256338119506836,
      "learning_rate": 8.053239398177191e-06,
      "loss": 0.1254,
      "mae_dtheta": 0.010215530171990395,
      "mae_dx": 0.0014096475206315517,
      "mae_dy": 0.0019332801457494497,
      "pose_mae_dtheta": 0.07042617350816727,
      "pose_mae_dx": 0.02180970087647438,
      "pose_mae_dy": 0.023806756362318993,
      "pose_rmse_dtheta": 0.21660955250263214,
      "pose_rmse_dx": 0.05307920277118683,
      "pose_rmse_dy": 0.05809039622545242,
      "pose_rmse_mean": 0.1092597171664238,
      "rmse_dtheta": 0.026280280202627182,
      "rmse_dx": 0.0038991908077150583,
      "rmse_dy": 0.004564094357192516,
      "rmse_mean": 0.01158118899911642,
      "rotation_flip": 0.0013959981733933091,
      "sparse_tokens": 32089.0,
      "step": 3577,
      "turn_loss": 0.06984637677669525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1662330421854674,
      "grad_norm": 0.5044580698013306,
      "learning_rate": 8.052192223133175e-06,
      "loss": 0.1222,
      "mae_dtheta": 0.01670185849070549,
      "mae_dx": 0.002828468568623066,
      "mae_dy": 0.0038687754422426224,
      "pose_mae_dtheta": 0.11326351016759872,
      "pose_mae_dx": 0.03667985647916794,
      "pose_mae_dy": 0.04162228852510452,
      "pose_rmse_dtheta": 0.2643771767616272,
      "pose_rmse_dx": 0.08865752816200256,
      "pose_rmse_dy": 0.08924210071563721,
      "pose_rmse_mean": 0.1474256068468094,
      "rmse_dtheta": 0.03165912628173828,
      "rmse_dx": 0.007642930373549461,
      "rmse_dy": 0.007152733858674765,
      "rmse_mean": 0.015484930947422981,
      "rotation_flip": 0.010995916090905666,
      "sparse_tokens": 32121.0,
      "step": 3578,
      "turn_loss": 0.12211267650127411,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.16627950195131017,
      "grad_norm": 0.46441981196403503,
      "learning_rate": 8.051144834647718e-06,
      "loss": 0.1084,
      "mae_dtheta": 0.04852863401174545,
      "mae_dx": 0.025257501751184464,
      "mae_dy": 0.01279012206941843,
      "pose_mae_dtheta": 0.3880675137042999,
      "pose_mae_dx": 0.20547553896903992,
      "pose_mae_dy": 0.11759879440069199,
      "pose_rmse_dtheta": 0.5985776782035828,
      "pose_rmse_dx": 0.38387587666511536,
      "pose_rmse_dy": 0.20391684770584106,
      "pose_rmse_mean": 0.39545679092407227,
      "rmse_dtheta": 0.06568025797605515,
      "rmse_dx": 0.03964222967624664,
      "rmse_dy": 0.020510897040367126,
      "rmse_mean": 0.0419444665312767,
      "rotation_flip": 0.032258063554763794,
      "sparse_tokens": 3224.0,
      "step": 3579,
      "turn_loss": 0.5284568071365356,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.16632596171715294,
      "grad_norm": 1.0161265134811401,
      "learning_rate": 8.050097232794066e-06,
      "loss": 0.2689,
      "mae_dtheta": 0.030959688127040863,
      "mae_dx": 0.010973670519888401,
      "mae_dy": 0.005407984834164381,
      "pose_mae_dtheta": 0.2478068768978119,
      "pose_mae_dx": 0.08956962078809738,
      "pose_mae_dy": 0.07453560829162598,
      "pose_rmse_dtheta": 0.4288281202316284,
      "pose_rmse_dx": 0.2118390053510666,
      "pose_rmse_dy": 0.14654193818569183,
      "pose_rmse_mean": 0.26240304112434387,
      "rmse_dtheta": 0.04649784788489342,
      "rmse_dx": 0.02387983165681362,
      "rmse_dy": 0.008963163010776043,
      "rmse_mean": 0.02644694596529007,
      "rotation_flip": 0.016651248559355736,
      "sparse_tokens": 21962.0,
      "step": 3580,
      "turn_loss": 0.2533265948295593,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.16637242148299572,
      "grad_norm": 0.41692137718200684,
      "learning_rate": 8.049049417645478e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.03906374052166939,
      "mae_dx": 0.013359364122152328,
      "mae_dy": 0.010412751697003841,
      "pose_mae_dtheta": 0.30858367681503296,
      "pose_mae_dx": 0.12547223269939423,
      "pose_mae_dy": 0.08393111824989319,
      "pose_rmse_dtheta": 0.5049991011619568,
      "pose_rmse_dx": 0.22251957654953003,
      "pose_rmse_dy": 0.2144739031791687,
      "pose_rmse_mean": 0.3139975368976593,
      "rmse_dtheta": 0.061131205409765244,
      "rmse_dx": 0.022569565102458,
      "rmse_dy": 0.021654294803738594,
      "rmse_mean": 0.035118356347084045,
      "rotation_flip": 0.025806451216340065,
      "sparse_tokens": 5774.0,
      "step": 3581,
      "turn_loss": 0.35427799820899963,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.1664188812488385,
      "grad_norm": 1.0732277631759644,
      "learning_rate": 8.048001389275227e-06,
      "loss": 0.2867,
      "mae_dtheta": 0.03357714042067528,
      "mae_dx": 0.008134506642818451,
      "mae_dy": 0.004482232499867678,
      "pose_mae_dtheta": 0.24182327091693878,
      "pose_mae_dx": 0.06341370940208435,
      "pose_mae_dy": 0.053446609526872635,
      "pose_rmse_dtheta": 0.4937950372695923,
      "pose_rmse_dx": 0.18673302233219147,
      "pose_rmse_dy": 0.10845202207565308,
      "pose_rmse_mean": 0.26299336552619934,
      "rmse_dtheta": 0.052639495581388474,
      "rmse_dx": 0.021427350118756294,
      "rmse_dy": 0.009742258116602898,
      "rmse_mean": 0.02793636918067932,
      "rotation_flip": 0.008561643771827221,
      "sparse_tokens": 10788.0,
      "step": 3582,
      "turn_loss": 0.21085266768932343,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.16646534101468127,
      "grad_norm": 0.3834034502506256,
      "learning_rate": 8.046953147756601e-06,
      "loss": 0.1029,
      "mae_dtheta": 0.03857974708080292,
      "mae_dx": 0.01012426894158125,
      "mae_dy": 0.009807431139051914,
      "pose_mae_dtheta": 0.2719047963619232,
      "pose_mae_dx": 0.07876255363225937,
      "pose_mae_dy": 0.13231408596038818,
      "pose_rmse_dtheta": 0.44572046399116516,
      "pose_rmse_dx": 0.1591104418039322,
      "pose_rmse_dy": 0.28649038076400757,
      "pose_rmse_mean": 0.29710710048675537,
      "rmse_dtheta": 0.05535430088639259,
      "rmse_dx": 0.020720472559332848,
      "rmse_dy": 0.01907907798886299,
      "rmse_mean": 0.03171795234084129,
      "rotation_flip": 0.017182130366563797,
      "sparse_tokens": 5722.0,
      "step": 3583,
      "turn_loss": 0.3405209183692932,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 12027.0,
      "epoch": 0.16651180078052408,
      "grad_norm": 0.5724478960037231,
      "learning_rate": 8.045904693162907e-06,
      "loss": 0.1839,
      "mae_dtheta": 0.02090858481824398,
      "mae_dx": 0.009653221815824509,
      "mae_dy": 0.004769324790686369,
      "pose_mae_dtheta": 0.1533573418855667,
      "pose_mae_dx": 0.0690421313047409,
      "pose_mae_dy": 0.06435984373092651,
      "pose_rmse_dtheta": 0.30211272835731506,
      "pose_rmse_dx": 0.16686849296092987,
      "pose_rmse_dy": 0.17576809227466583,
      "pose_rmse_mean": 0.2149164378643036,
      "rmse_dtheta": 0.037618961185216904,
      "rmse_dx": 0.021187735721468925,
      "rmse_dy": 0.010640708729624748,
      "rmse_mean": 0.02314913645386696,
      "rotation_flip": 0.007614213041961193,
      "sparse_tokens": 9628.0,
      "step": 3584,
      "turn_loss": 0.2249935269355774,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16655826054636685,
      "grad_norm": 0.8767899870872498,
      "learning_rate": 8.044856025567464e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.0072240075096488,
      "mae_dx": 0.003302569966763258,
      "mae_dy": 0.0008641410386189818,
      "pose_mae_dtheta": 0.057658351957798004,
      "pose_mae_dx": 0.030613653361797333,
      "pose_mae_dy": 0.015381244011223316,
      "pose_rmse_dtheta": 0.16493934392929077,
      "pose_rmse_dx": 0.10124895721673965,
      "pose_rmse_dy": 0.04603022336959839,
      "pose_rmse_mean": 0.10407283902168274,
      "rmse_dtheta": 0.020587250590324402,
      "rmse_dx": 0.010739739052951336,
      "rmse_dy": 0.0024259283673018217,
      "rmse_mean": 0.011250972747802734,
      "rotation_flip": 0.00817438680678606,
      "sparse_tokens": 32105.0,
      "step": 3585,
      "turn_loss": 0.07035364210605621,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.16660472031220963,
      "grad_norm": 0.6139424443244934,
      "learning_rate": 8.043807145043604e-06,
      "loss": 0.1531,
      "mae_dtheta": 0.009570588357746601,
      "mae_dx": 0.002381212543696165,
      "mae_dy": 0.0029281489551067352,
      "pose_mae_dtheta": 0.07083676755428314,
      "pose_mae_dx": 0.0306268148124218,
      "pose_mae_dy": 0.029395101591944695,
      "pose_rmse_dtheta": 0.1766752153635025,
      "pose_rmse_dx": 0.09428275376558304,
      "pose_rmse_dy": 0.06522972881793976,
      "pose_rmse_mean": 0.11206257343292236,
      "rmse_dtheta": 0.02189887873828411,
      "rmse_dx": 0.007897263392806053,
      "rmse_dy": 0.007340684998780489,
      "rmse_mean": 0.012378942221403122,
      "rotation_flip": 0.0049393801018595695,
      "sparse_tokens": 32057.0,
      "step": 3586,
      "turn_loss": 0.10354095697402954,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.1666511800780524,
      "grad_norm": 0.4794267416000366,
      "learning_rate": 8.042758051664677e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.011058595031499863,
      "mae_dx": 0.0018059188732877374,
      "mae_dy": 0.001847598236054182,
      "pose_mae_dtheta": 0.07743087410926819,
      "pose_mae_dx": 0.023016387596726418,
      "pose_mae_dy": 0.02719111368060112,
      "pose_rmse_dtheta": 0.21620362997055054,
      "pose_rmse_dx": 0.06662462651729584,
      "pose_rmse_dy": 0.06745988130569458,
      "pose_rmse_mean": 0.11676272004842758,
      "rmse_dtheta": 0.024339884519577026,
      "rmse_dx": 0.006531900726258755,
      "rmse_dy": 0.003845380851998925,
      "rmse_mean": 0.011572389863431454,
      "rotation_flip": 0.002311604330316186,
      "sparse_tokens": 32041.0,
      "step": 3587,
      "turn_loss": 0.07501797378063202,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.16669763984389518,
      "grad_norm": 0.6478674411773682,
      "learning_rate": 8.041708745504046e-06,
      "loss": 0.1593,
      "mae_dtheta": 0.04057322442531586,
      "mae_dx": 0.01089983806014061,
      "mae_dy": 0.016728080809116364,
      "pose_mae_dtheta": 0.3402656018733978,
      "pose_mae_dx": 0.10721545666456223,
      "pose_mae_dy": 0.1348237246274948,
      "pose_rmse_dtheta": 0.540480375289917,
      "pose_rmse_dx": 0.20253977179527283,
      "pose_rmse_dy": 0.2701357901096344,
      "pose_rmse_mean": 0.337718665599823,
      "rmse_dtheta": 0.058798983693122864,
      "rmse_dx": 0.019487427547574043,
      "rmse_dy": 0.030088961124420166,
      "rmse_mean": 0.036125123500823975,
      "rotation_flip": 0.010380622930824757,
      "sparse_tokens": 5092.0,
      "step": 3588,
      "turn_loss": 0.5139883756637573,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.16674409960973796,
      "grad_norm": 0.3986535966396332,
      "learning_rate": 8.04065922663509e-06,
      "loss": 0.0697,
      "mae_dtheta": 0.039599619805812836,
      "mae_dx": 0.014827461913228035,
      "mae_dy": 0.006732217967510223,
      "pose_mae_dtheta": 0.3115261197090149,
      "pose_mae_dx": 0.12082697451114655,
      "pose_mae_dy": 0.13883358240127563,
      "pose_rmse_dtheta": 0.45902153849601746,
      "pose_rmse_dx": 0.2352238893508911,
      "pose_rmse_dy": 0.2650383412837982,
      "pose_rmse_mean": 0.3197612762451172,
      "rmse_dtheta": 0.05321422219276428,
      "rmse_dx": 0.027456751093268394,
      "rmse_dy": 0.010789000429213047,
      "rmse_mean": 0.030486658215522766,
      "rotation_flip": 0.022058824077248573,
      "sparse_tokens": 4319.0,
      "step": 3589,
      "turn_loss": 0.35417547821998596,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.16679055937558074,
      "grad_norm": 0.5915845632553101,
      "learning_rate": 8.039609495131201e-06,
      "loss": 0.141,
      "mae_dtheta": 0.015531363897025585,
      "mae_dx": 0.00312430108897388,
      "mae_dy": 0.005484950263053179,
      "pose_mae_dtheta": 0.11239048093557358,
      "pose_mae_dx": 0.042690761387348175,
      "pose_mae_dy": 0.05017351731657982,
      "pose_rmse_dtheta": 0.23122325539588928,
      "pose_rmse_dx": 0.10790902376174927,
      "pose_rmse_dy": 0.10760840028524399,
      "pose_rmse_mean": 0.14891356229782104,
      "rmse_dtheta": 0.028069978579878807,
      "rmse_dx": 0.009061302058398724,
      "rmse_dy": 0.011403853073716164,
      "rmse_mean": 0.016178376972675323,
      "rotation_flip": 0.004904966335743666,
      "sparse_tokens": 32089.0,
      "step": 3590,
      "turn_loss": 0.13817518949508667,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.16683701914142351,
      "grad_norm": 0.675442099571228,
      "learning_rate": 8.038559551065792e-06,
      "loss": 0.139,
      "mae_dtheta": 0.009191961027681828,
      "mae_dx": 0.001699549495242536,
      "mae_dy": 0.00218408671207726,
      "pose_mae_dtheta": 0.06265483796596527,
      "pose_mae_dx": 0.019843511283397675,
      "pose_mae_dy": 0.02543298527598381,
      "pose_rmse_dtheta": 0.16769391298294067,
      "pose_rmse_dx": 0.05535401776432991,
      "pose_rmse_dy": 0.06325393170118332,
      "pose_rmse_mean": 0.09543395042419434,
      "rmse_dtheta": 0.022793149575591087,
      "rmse_dx": 0.006056108977645636,
      "rmse_dy": 0.006620089523494244,
      "rmse_mean": 0.011823116801679134,
      "rotation_flip": 0.0024236547760665417,
      "sparse_tokens": 32073.0,
      "step": 3591,
      "turn_loss": 0.07957518100738525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16688347890726632,
      "grad_norm": 0.4273805618286133,
      "learning_rate": 8.03750939451228e-06,
      "loss": 0.1175,
      "mae_dtheta": 0.010619438253343105,
      "mae_dx": 0.001976179424673319,
      "mae_dy": 0.0016122295055538416,
      "pose_mae_dtheta": 0.07510297000408173,
      "pose_mae_dx": 0.019343571737408638,
      "pose_mae_dy": 0.020796718075871468,
      "pose_rmse_dtheta": 0.21609289944171906,
      "pose_rmse_dx": 0.05933757126331329,
      "pose_rmse_dy": 0.05735759437084198,
      "pose_rmse_mean": 0.11092935502529144,
      "rmse_dtheta": 0.025461986660957336,
      "rmse_dx": 0.0070524499751627445,
      "rmse_dy": 0.004629319533705711,
      "rmse_mean": 0.012381253764033318,
      "rotation_flip": 0.0045340051874518394,
      "sparse_tokens": 32105.0,
      "step": 3592,
      "turn_loss": 0.08877748250961304,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.1669299386731091,
      "grad_norm": 0.4927288293838501,
      "learning_rate": 8.036459025544106e-06,
      "loss": 0.1334,
      "mae_dtheta": 0.036085277795791626,
      "mae_dx": 0.013258012942969799,
      "mae_dy": 0.006594459060579538,
      "pose_mae_dtheta": 0.2785685360431671,
      "pose_mae_dx": 0.10427097976207733,
      "pose_mae_dy": 0.07055040448904037,
      "pose_rmse_dtheta": 0.4920438230037689,
      "pose_rmse_dx": 0.19803035259246826,
      "pose_rmse_dy": 0.15494152903556824,
      "pose_rmse_mean": 0.281671941280365,
      "rmse_dtheta": 0.05406423285603523,
      "rmse_dx": 0.02433101274073124,
      "rmse_dy": 0.012314136140048504,
      "rmse_mean": 0.030236460268497467,
      "rotation_flip": 0.010989011265337467,
      "sparse_tokens": 14114.0,
      "step": 3593,
      "turn_loss": 0.3163659870624542,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 21747.0,
      "epoch": 0.16697639843895187,
      "grad_norm": 0.9181471467018127,
      "learning_rate": 8.035408444234723e-06,
      "loss": 0.2187,
      "mae_dtheta": 0.020521920174360275,
      "mae_dx": 0.013874499127268791,
      "mae_dy": 0.00341911893337965,
      "pose_mae_dtheta": 0.15220755338668823,
      "pose_mae_dx": 0.10737299919128418,
      "pose_mae_dy": 0.048911359161138535,
      "pose_rmse_dtheta": 0.2781974971294403,
      "pose_rmse_dx": 0.24113641679286957,
      "pose_rmse_dy": 0.12430036067962646,
      "pose_rmse_mean": 0.21454475820064545,
      "rmse_dtheta": 0.03429148718714714,
      "rmse_dx": 0.027633896097540855,
      "rmse_dy": 0.006348638329654932,
      "rmse_mean": 0.022758007049560547,
      "rotation_flip": 0.0065104165114462376,
      "sparse_tokens": 15917.0,
      "step": 3594,
      "turn_loss": 0.18718388676643372,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.16702285820479465,
      "grad_norm": 0.6818867921829224,
      "learning_rate": 8.034357650657597e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.015547658316791058,
      "mae_dx": 0.004150715656578541,
      "mae_dy": 0.005605049431324005,
      "pose_mae_dtheta": 0.11817464977502823,
      "pose_mae_dx": 0.045543815940618515,
      "pose_mae_dy": 0.060315702110528946,
      "pose_rmse_dtheta": 0.22873342037200928,
      "pose_rmse_dx": 0.11334757506847382,
      "pose_rmse_dy": 0.12784746289253235,
      "pose_rmse_mean": 0.1566428244113922,
      "rmse_dtheta": 0.02741137146949768,
      "rmse_dx": 0.010384900495409966,
      "rmse_dy": 0.010346069931983948,
      "rmse_mean": 0.01604744791984558,
      "rotation_flip": 0.0,
      "sparse_tokens": 5639.0,
      "step": 3595,
      "turn_loss": 0.1347021460533142,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.16706931797063743,
      "grad_norm": 0.5897619724273682,
      "learning_rate": 8.033306644886215e-06,
      "loss": 0.1244,
      "mae_dtheta": 0.03133365511894226,
      "mae_dx": 0.01228928379714489,
      "mae_dy": 0.005161057226359844,
      "pose_mae_dtheta": 0.19746258854866028,
      "pose_mae_dx": 0.09477455168962479,
      "pose_mae_dy": 0.06535130739212036,
      "pose_rmse_dtheta": 0.3486154079437256,
      "pose_rmse_dx": 0.21108177304267883,
      "pose_rmse_dy": 0.14025156199932098,
      "pose_rmse_mean": 0.23331624269485474,
      "rmse_dtheta": 0.04777362942695618,
      "rmse_dx": 0.024784335866570473,
      "rmse_dy": 0.009239965118467808,
      "rmse_mean": 0.02726597711443901,
      "rotation_flip": 0.02168021723628044,
      "sparse_tokens": 6807.0,
      "step": 3596,
      "turn_loss": 0.2601465582847595,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.1671157777364802,
      "grad_norm": 0.9731255769729614,
      "learning_rate": 8.032255426994069e-06,
      "loss": 0.2948,
      "mae_dtheta": 0.038416244089603424,
      "mae_dx": 0.015418404713273048,
      "mae_dy": 0.006405294872820377,
      "pose_mae_dtheta": 0.32497477531433105,
      "pose_mae_dx": 0.11449511349201202,
      "pose_mae_dy": 0.08629320561885834,
      "pose_rmse_dtheta": 0.5148196816444397,
      "pose_rmse_dx": 0.2402631938457489,
      "pose_rmse_dy": 0.19239172339439392,
      "pose_rmse_mean": 0.31582486629486084,
      "rmse_dtheta": 0.05478280037641525,
      "rmse_dx": 0.028368832543492317,
      "rmse_dy": 0.01219729520380497,
      "rmse_mean": 0.031782977283000946,
      "rotation_flip": 0.015568862669169903,
      "sparse_tokens": 26804.0,
      "step": 3597,
      "turn_loss": 0.31582531332969666,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.16716223750232298,
      "grad_norm": 0.5571156740188599,
      "learning_rate": 8.031203997054671e-06,
      "loss": 0.2086,
      "mae_dtheta": 0.0402669832110405,
      "mae_dx": 0.016593920066952705,
      "mae_dy": 0.0075198812410235405,
      "pose_mae_dtheta": 0.3385704457759857,
      "pose_mae_dx": 0.13160158693790436,
      "pose_mae_dy": 0.08590149879455566,
      "pose_rmse_dtheta": 0.5321128964424133,
      "pose_rmse_dx": 0.2526909410953522,
      "pose_rmse_dy": 0.19227640330791473,
      "pose_rmse_mean": 0.32569342851638794,
      "rmse_dtheta": 0.057335346937179565,
      "rmse_dx": 0.02902749553322792,
      "rmse_dy": 0.013914993964135647,
      "rmse_mean": 0.0334259457886219,
      "rotation_flip": 0.010989011265337467,
      "sparse_tokens": 22210.0,
      "step": 3598,
      "turn_loss": 0.34037643671035767,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 40563.0,
      "epoch": 0.16720869726816576,
      "grad_norm": 0.5401546955108643,
      "learning_rate": 8.030152355141553e-06,
      "loss": 0.1312,
      "mae_dtheta": 0.03293256834149361,
      "mae_dx": 0.01167274359613657,
      "mae_dy": 0.0055107963271439075,
      "pose_mae_dtheta": 0.2505928575992584,
      "pose_mae_dx": 0.09008660167455673,
      "pose_mae_dy": 0.05564779415726662,
      "pose_rmse_dtheta": 0.4249219298362732,
      "pose_rmse_dx": 0.1910867840051651,
      "pose_rmse_dy": 0.14184452593326569,
      "pose_rmse_mean": 0.252617746591568,
      "rmse_dtheta": 0.050274983048439026,
      "rmse_dx": 0.023067118600010872,
      "rmse_dy": 0.012036529369652271,
      "rmse_mean": 0.028459545224905014,
      "rotation_flip": 0.010816126130521297,
      "sparse_tokens": 30063.0,
      "step": 3599,
      "turn_loss": 0.2646304666996002,
      "turns": 125.0,
      "turns_per_sample": 125.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.16725515703400856,
      "grad_norm": 0.5778427720069885,
      "learning_rate": 8.029100501328257e-06,
      "loss": 0.0698,
      "mae_dtheta": 0.010035429149866104,
      "mae_dx": 0.0021589945536106825,
      "mae_dy": 0.0024163066409528255,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.577842652797699,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.72695922851562,
      "model/head/act_norm_mean": 114.64938446969697,
      "model/head/act_norm_min": 75.01171112060547,
      "model/head/act_over_embed": 78.7881303720243,
      "model/head/grad_frac": 0.08807782828807831,
      "model/head/grad_norm": 0.050895124673843384,
      "model/head/grad_zero_frac": 0.00016402950859628618,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6918698705808081,
      "model/head/update_ratio": 0.0008760184282436967,
      "model/head/weight_delta": 7.069947719573975,
      "model/head/weight_delta_rel": 0.12402782589197159,
      "model/head/weight_norm": 58.098236083984375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41707316040992737,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4169973415798611,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41693738102912903,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28656447712430083,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06998750567436218,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04044176638126373,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5185677083333333,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013107684208080173,
      "model/modality_embedder.encoders.pose/weight_delta": 2.3127264976501465,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07556398212909698,
      "model/modality_embedder.encoders.pose/weight_norm": 30.853479385375977,
      "model/modality_embedder/grad_frac": 0.06998750567436218,
      "model/modality_embedder/grad_norm": 0.04044176638126373,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5185677083333333,
      "model/modality_embedder/update_ratio": 0.0013107684208080173,
      "model/modality_embedder/weight_delta": 2.3127264976501465,
      "model/modality_embedder/weight_delta_rel": 0.07556398212909698,
      "model/modality_embedder/weight_norm": 30.853479385375977,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.67993927001953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.980734928651597,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.032233238220215,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.47978555414701,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07612227648496628,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04398669674992561,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015866982284933329,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.6169899702072144,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05892409011721611,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.722156524658203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.08365631103516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.982503607503606,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.27640438079834,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.168210368960246,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08021160960197449,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04634968936443329,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015781143447384238,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.0412282943725586,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07070974260568619,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.370298385620117,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.75916290283203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.83873957832291,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.449222564697266,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.443833106462233,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09327711910009384,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05389949679374695,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 7.06100690877065e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017777795437723398,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.1880836486816406,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07347175478935242,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.318437576293945,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.63473510742188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.67076018117685,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.276777267456055,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.70281481639057,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12793006002902985,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07392344623804092,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 4.034861194668338e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0024935135152190924,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.8671927452087402,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0638117864727974,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.646299362182617,
      "model/normalizer/grad_frac": 0.4984853267669678,
      "model/normalizer/grad_norm": 0.28804609179496765,
      "model/normalizer/grad_zero_frac": 9.572081035003066e-05,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0036829954478889704,
      "model/normalizer/weight_delta": 3.971277952194214,
      "model/normalizer/weight_delta_rel": 0.05114775896072388,
      "model/normalizer/weight_norm": 78.20973205566406,
      "pose_mae_dtheta": 0.07170414924621582,
      "pose_mae_dx": 0.026471517980098724,
      "pose_mae_dy": 0.02878357283771038,
      "pose_rmse_dtheta": 0.15346777439117432,
      "pose_rmse_dx": 0.06120280176401138,
      "pose_rmse_dy": 0.07849674671888351,
      "pose_rmse_mean": 0.09772244095802307,
      "rmse_dtheta": 0.019822387024760246,
      "rmse_dx": 0.006061657331883907,
      "rmse_dy": 0.005350983235985041,
      "rmse_mean": 0.01041167601943016,
      "rotation_flip": 0.0037936267908662558,
      "sparse_tokens": 32121.0,
      "step": 3600,
      "turn_loss": 0.07843191176652908,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.16725515703400856,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3188110888004303,
      "eval_objectnav_nopose_mae_dtheta": 0.04115639626979828,
      "eval_objectnav_nopose_mae_dx": 0.014169146306812763,
      "eval_objectnav_nopose_mae_dy": 0.004926036112010479,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3347822427749634,
      "eval_objectnav_nopose_pose_mae_dx": 0.11458179354667664,
      "eval_objectnav_nopose_pose_mae_dy": 0.05611766129732132,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5561699271202087,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2471691370010376,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1342189460992813,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3125193417072296,
      "eval_objectnav_nopose_rmse_dtheta": 0.058694951236248016,
      "eval_objectnav_nopose_rmse_dx": 0.027103619650006294,
      "eval_objectnav_nopose_rmse_dy": 0.010254517197608948,
      "eval_objectnav_nopose_rmse_mean": 0.032017696648836136,
      "eval_objectnav_nopose_rotation_flip": 0.015426876954734325,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3188110888004303,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 3600
    },
    {
      "epoch": 0.16725515703400856,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28681305050849915,
      "eval_objectnav_pose_mae_dtheta": 0.03641767054796219,
      "eval_objectnav_pose_mae_dx": 0.01230727881193161,
      "eval_objectnav_pose_mae_dy": 0.004675607662647963,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2800252139568329,
      "eval_objectnav_pose_pose_mae_dx": 0.09719441831111908,
      "eval_objectnav_pose_pose_mae_dy": 0.050078585743904114,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.48275285959243774,
      "eval_objectnav_pose_pose_rmse_dx": 0.22213566303253174,
      "eval_objectnav_pose_pose_rmse_dy": 0.11909369379281998,
      "eval_objectnav_pose_pose_rmse_mean": 0.27466076612472534,
      "eval_objectnav_pose_rmse_dtheta": 0.05401134863495827,
      "eval_objectnav_pose_rmse_dx": 0.02479279786348343,
      "eval_objectnav_pose_rmse_dy": 0.009749147109687328,
      "eval_objectnav_pose_rmse_mean": 0.0295177660882473,
      "eval_objectnav_pose_rotation_flip": 0.014278914779424667,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28681305050849915,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 3600
    },
    {
      "epoch": 0.16725515703400856,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.1016642227768898,
      "eval_pointnav_mae_dtheta": 0.01201158668845892,
      "eval_pointnav_mae_dx": 0.002990311710163951,
      "eval_pointnav_mae_dy": 0.0029535333160310984,
      "eval_pointnav_pose_mae_dtheta": 0.08568158745765686,
      "eval_pointnav_pose_mae_dx": 0.03423980250954628,
      "eval_pointnav_pose_mae_dy": 0.03273341432213783,
      "eval_pointnav_pose_rmse_dtheta": 0.22539746761322021,
      "eval_pointnav_pose_rmse_dx": 0.09548822790384293,
      "eval_pointnav_pose_rmse_dy": 0.09353626519441605,
      "eval_pointnav_pose_rmse_mean": 0.13814064860343933,
      "eval_pointnav_rmse_dtheta": 0.027455270290374756,
      "eval_pointnav_rmse_dx": 0.008536478504538536,
      "eval_pointnav_rmse_dy": 0.007559802383184433,
      "eval_pointnav_rmse_mean": 0.014517184346914291,
      "eval_pointnav_rotation_flip": 0.005658324342221022,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.1016642227768898,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 3600
    },
    {
      "epoch": 0.16725515703400856,
      "eval_loss": 0.23576278736193976,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3188110888004303,
      "eval_objectnav_nopose_mae_dtheta": 0.04115639626979828,
      "eval_objectnav_nopose_mae_dx": 0.014169146306812763,
      "eval_objectnav_nopose_mae_dy": 0.004926036112010479,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3347822427749634,
      "eval_objectnav_nopose_pose_mae_dx": 0.11458179354667664,
      "eval_objectnav_nopose_pose_mae_dy": 0.05611766129732132,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5561699271202087,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2471691370010376,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1342189460992813,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3125193417072296,
      "eval_objectnav_nopose_rmse_dtheta": 0.058694951236248016,
      "eval_objectnav_nopose_rmse_dx": 0.027103619650006294,
      "eval_objectnav_nopose_rmse_dy": 0.010254517197608948,
      "eval_objectnav_nopose_rmse_mean": 0.032017696648836136,
      "eval_objectnav_nopose_rotation_flip": 0.015426876954734325,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3188110888004303,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28681305050849915,
      "eval_objectnav_pose_mae_dtheta": 0.03641767054796219,
      "eval_objectnav_pose_mae_dx": 0.01230727881193161,
      "eval_objectnav_pose_mae_dy": 0.004675607662647963,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2800252139568329,
      "eval_objectnav_pose_pose_mae_dx": 0.09719441831111908,
      "eval_objectnav_pose_pose_mae_dy": 0.050078585743904114,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.48275285959243774,
      "eval_objectnav_pose_pose_rmse_dx": 0.22213566303253174,
      "eval_objectnav_pose_pose_rmse_dy": 0.11909369379281998,
      "eval_objectnav_pose_pose_rmse_mean": 0.27466076612472534,
      "eval_objectnav_pose_rmse_dtheta": 0.05401134863495827,
      "eval_objectnav_pose_rmse_dx": 0.02479279786348343,
      "eval_objectnav_pose_rmse_dy": 0.009749147109687328,
      "eval_objectnav_pose_rmse_mean": 0.0295177660882473,
      "eval_objectnav_pose_rotation_flip": 0.014278914779424667,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28681305050849915,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.1016642227768898,
      "eval_pointnav_mae_dtheta": 0.01201158668845892,
      "eval_pointnav_mae_dx": 0.002990311710163951,
      "eval_pointnav_mae_dy": 0.0029535333160310984,
      "eval_pointnav_pose_mae_dtheta": 0.08568158745765686,
      "eval_pointnav_pose_mae_dx": 0.03423980250954628,
      "eval_pointnav_pose_mae_dy": 0.03273341432213783,
      "eval_pointnav_pose_rmse_dtheta": 0.22539746761322021,
      "eval_pointnav_pose_rmse_dx": 0.09548822790384293,
      "eval_pointnav_pose_rmse_dy": 0.09353626519441605,
      "eval_pointnav_pose_rmse_mean": 0.13814064860343933,
      "eval_pointnav_rmse_dtheta": 0.027455270290374756,
      "eval_pointnav_rmse_dx": 0.008536478504538536,
      "eval_pointnav_rmse_dy": 0.007559802383184433,
      "eval_pointnav_rmse_mean": 0.014517184346914291,
      "eval_pointnav_rotation_flip": 0.005658324342221022,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.1016642227768898,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 3600
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.16730161679985134,
      "grad_norm": 0.5874114036560059,
      "learning_rate": 8.028048435688333e-06,
      "loss": 0.1622,
      "mae_dtheta": 0.03782631456851959,
      "mae_dx": 0.01663796603679657,
      "mae_dy": 0.007574453018605709,
      "pose_mae_dtheta": 0.25819581747055054,
      "pose_mae_dx": 0.12265845388174057,
      "pose_mae_dy": 0.13677774369716644,
      "pose_rmse_dtheta": 0.43363937735557556,
      "pose_rmse_dx": 0.24966274201869965,
      "pose_rmse_dy": 0.24328087270259857,
      "pose_rmse_mean": 0.30886101722717285,
      "rmse_dtheta": 0.05215839296579361,
      "rmse_dx": 0.0316527783870697,
      "rmse_dy": 0.011911463923752308,
      "rmse_mean": 0.031907547265291214,
      "rotation_flip": 0.013333333656191826,
      "sparse_tokens": 8393.0,
      "step": 3601,
      "turn_loss": 0.3045579493045807,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.16734807656569411,
      "grad_norm": 0.573318362236023,
      "learning_rate": 8.026996158295359e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.04295530170202255,
      "mae_dx": 0.013890386559069157,
      "mae_dy": 0.004090473987162113,
      "pose_mae_dtheta": 0.3262959122657776,
      "pose_mae_dx": 0.11519636958837509,
      "pose_mae_dy": 0.050432827323675156,
      "pose_rmse_dtheta": 0.603297233581543,
      "pose_rmse_dx": 0.24239680171012878,
      "pose_rmse_dy": 0.10852349549531937,
      "pose_rmse_mean": 0.31807252764701843,
      "rmse_dtheta": 0.06339696794748306,
      "rmse_dx": 0.026423631235957146,
      "rmse_dy": 0.007848335430026054,
      "rmse_mean": 0.03255631402134895,
      "rotation_flip": 0.01909722201526165,
      "sparse_tokens": 8971.0,
      "step": 3602,
      "turn_loss": 0.316292405128479,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1673945363315369,
      "grad_norm": 0.9801304936408997,
      "learning_rate": 8.02594366922292e-06,
      "loss": 0.1595,
      "mae_dtheta": 0.01054155733436346,
      "mae_dx": 0.002653795061632991,
      "mae_dy": 0.0020355188753455877,
      "pose_mae_dtheta": 0.0724124014377594,
      "pose_mae_dx": 0.02785363420844078,
      "pose_mae_dy": 0.029367035254836082,
      "pose_rmse_dtheta": 0.15034453570842743,
      "pose_rmse_dx": 0.08339986205101013,
      "pose_rmse_dy": 0.07440117001533508,
      "pose_rmse_mean": 0.10271519422531128,
      "rmse_dtheta": 0.0206877663731575,
      "rmse_dx": 0.00886627845466137,
      "rmse_dy": 0.00453942222520709,
      "rmse_mean": 0.011364488862454891,
      "rotation_flip": 0.007515472825616598,
      "sparse_tokens": 32073.0,
      "step": 3603,
      "turn_loss": 0.07795354723930359,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.16744099609737967,
      "grad_norm": 0.46632322669029236,
      "learning_rate": 8.024890968544614e-06,
      "loss": 0.1524,
      "mae_dtheta": 0.012540949508547783,
      "mae_dx": 0.0036734689492732286,
      "mae_dy": 0.0033586667850613594,
      "pose_mae_dtheta": 0.0893382802605629,
      "pose_mae_dx": 0.04343480244278908,
      "pose_mae_dy": 0.03742499649524689,
      "pose_rmse_dtheta": 0.18354186415672302,
      "pose_rmse_dx": 0.12203039973974228,
      "pose_rmse_dy": 0.0942039042711258,
      "pose_rmse_mean": 0.13325873017311096,
      "rmse_dtheta": 0.024357452988624573,
      "rmse_dx": 0.010059934109449387,
      "rmse_dy": 0.009008549153804779,
      "rmse_mean": 0.01447531208395958,
      "rotation_flip": 0.005300353281199932,
      "sparse_tokens": 32121.0,
      "step": 3604,
      "turn_loss": 0.1172129288315773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.16748745586322245,
      "grad_norm": 0.6678343415260315,
      "learning_rate": 8.023838056334059e-06,
      "loss": 0.1324,
      "mae_dtheta": 0.03385620564222336,
      "mae_dx": 0.015826940536499023,
      "mae_dy": 0.004249449819326401,
      "pose_mae_dtheta": 0.2928416132926941,
      "pose_mae_dx": 0.13076676428318024,
      "pose_mae_dy": 0.05108038708567619,
      "pose_rmse_dtheta": 0.47460559010505676,
      "pose_rmse_dx": 0.25437790155410767,
      "pose_rmse_dy": 0.12728358805179596,
      "pose_rmse_mean": 0.2854223847389221,
      "rmse_dtheta": 0.05106678977608681,
      "rmse_dx": 0.028498759493231773,
      "rmse_dy": 0.0068570831790566444,
      "rmse_mean": 0.028807543218135834,
      "rotation_flip": 0.012987012974917889,
      "sparse_tokens": 6544.0,
      "step": 3605,
      "turn_loss": 0.26767757534980774,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 4563.0,
      "epoch": 0.16753391562906522,
      "grad_norm": 0.7697535753250122,
      "learning_rate": 8.022784932664885e-06,
      "loss": 0.258,
      "mae_dtheta": 0.04177238792181015,
      "mae_dx": 0.009003411047160625,
      "mae_dy": 0.006364436820149422,
      "pose_mae_dtheta": 0.3659689426422119,
      "pose_mae_dx": 0.09228915721178055,
      "pose_mae_dy": 0.08105144649744034,
      "pose_rmse_dtheta": 0.5996310710906982,
      "pose_rmse_dx": 0.18748588860034943,
      "pose_rmse_dy": 0.18340420722961426,
      "pose_rmse_mean": 0.32350707054138184,
      "rmse_dtheta": 0.0625898689031601,
      "rmse_dx": 0.017664916813373566,
      "rmse_dy": 0.012087234295904636,
      "rmse_mean": 0.030780673027038574,
      "rotation_flip": 0.02926829271018505,
      "sparse_tokens": 3781.0,
      "step": 3606,
      "turn_loss": 0.31355714797973633,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.167580375394908,
      "grad_norm": 0.5468809008598328,
      "learning_rate": 8.02173159761074e-06,
      "loss": 0.1469,
      "mae_dtheta": 0.011629440821707249,
      "mae_dx": 0.003604753175750375,
      "mae_dy": 0.003813598770648241,
      "pose_mae_dtheta": 0.08019516617059708,
      "pose_mae_dx": 0.03841555863618851,
      "pose_mae_dy": 0.03800063952803612,
      "pose_rmse_dtheta": 0.1644444465637207,
      "pose_rmse_dx": 0.09565448015928268,
      "pose_rmse_dy": 0.0734674483537674,
      "pose_rmse_mean": 0.11118879169225693,
      "rmse_dtheta": 0.022200455889105797,
      "rmse_dx": 0.01002475991845131,
      "rmse_dy": 0.0088748624548316,
      "rmse_mean": 0.013700026087462902,
      "rotation_flip": 0.004298554267734289,
      "sparse_tokens": 32073.0,
      "step": 3607,
      "turn_loss": 0.14047692716121674,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.1676268351607508,
      "grad_norm": 0.757792055606842,
      "learning_rate": 8.020678051245282e-06,
      "loss": 0.1984,
      "mae_dtheta": 0.04221752658486366,
      "mae_dx": 0.015054033137857914,
      "mae_dy": 0.007958026602864265,
      "pose_mae_dtheta": 0.3360549509525299,
      "pose_mae_dx": 0.11966228485107422,
      "pose_mae_dy": 0.06693191081285477,
      "pose_rmse_dtheta": 0.5834948420524597,
      "pose_rmse_dx": 0.23868457973003387,
      "pose_rmse_dy": 0.16543975472450256,
      "pose_rmse_mean": 0.3292064070701599,
      "rmse_dtheta": 0.06140008941292763,
      "rmse_dx": 0.026651080697774887,
      "rmse_dy": 0.01734255999326706,
      "rmse_mean": 0.035131245851516724,
      "rotation_flip": 0.021705426275730133,
      "sparse_tokens": 20485.0,
      "step": 3608,
      "turn_loss": 0.3644518256187439,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.16767329492659358,
      "grad_norm": 0.3725374639034271,
      "learning_rate": 8.019624293642187e-06,
      "loss": 0.0948,
      "mae_dtheta": 0.043473608791828156,
      "mae_dx": 0.004990545567125082,
      "mae_dy": 0.008774062618613243,
      "pose_mae_dtheta": 0.39880189299583435,
      "pose_mae_dx": 0.0775662288069725,
      "pose_mae_dy": 0.10640536993741989,
      "pose_rmse_dtheta": 0.6512249112129211,
      "pose_rmse_dx": 0.14451773464679718,
      "pose_rmse_dy": 0.2191484421491623,
      "pose_rmse_mean": 0.3382970094680786,
      "rmse_dtheta": 0.062233928591012955,
      "rmse_dx": 0.010093187913298607,
      "rmse_dy": 0.014553136192262173,
      "rmse_mean": 0.028960084542632103,
      "rotation_flip": 0.004347825888544321,
      "sparse_tokens": 4268.0,
      "step": 3609,
      "turn_loss": 0.29423731565475464,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.16771975469243636,
      "grad_norm": 0.7071565985679626,
      "learning_rate": 8.018570324875143e-06,
      "loss": 0.1131,
      "mae_dtheta": 0.013973568566143513,
      "mae_dx": 0.003059615381062031,
      "mae_dy": 0.004479630384594202,
      "pose_mae_dtheta": 0.094816192984581,
      "pose_mae_dx": 0.03487137705087662,
      "pose_mae_dy": 0.04946800321340561,
      "pose_rmse_dtheta": 0.19284610450267792,
      "pose_rmse_dx": 0.07832223176956177,
      "pose_rmse_dy": 0.11642083525657654,
      "pose_rmse_mean": 0.1291964054107666,
      "rmse_dtheta": 0.02621547505259514,
      "rmse_dx": 0.00945886317640543,
      "rmse_dy": 0.010448886081576347,
      "rmse_mean": 0.015374407172203064,
      "rotation_flip": 0.003765060333535075,
      "sparse_tokens": 32057.0,
      "step": 3610,
      "turn_loss": 0.14853912591934204,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16776621445827913,
      "grad_norm": 0.6291525363922119,
      "learning_rate": 8.017516145017857e-06,
      "loss": 0.111,
      "mae_dtheta": 0.010847384110093117,
      "mae_dx": 0.00265062996186316,
      "mae_dy": 0.0040627894923090935,
      "pose_mae_dtheta": 0.07775626331567764,
      "pose_mae_dx": 0.033294178545475006,
      "pose_mae_dy": 0.040255095809698105,
      "pose_rmse_dtheta": 0.14500734210014343,
      "pose_rmse_dx": 0.07320931553840637,
      "pose_rmse_dy": 0.09302057325839996,
      "pose_rmse_mean": 0.10374574363231659,
      "rmse_dtheta": 0.02177736908197403,
      "rmse_dx": 0.00734656723216176,
      "rmse_dy": 0.009381945244967937,
      "rmse_mean": 0.012835294008255005,
      "rotation_flip": 0.009577864781022072,
      "sparse_tokens": 32105.0,
      "step": 3611,
      "turn_loss": 0.10933692008256912,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1678126742241219,
      "grad_norm": 0.5125942826271057,
      "learning_rate": 8.016461754144047e-06,
      "loss": 0.0881,
      "mae_dtheta": 0.009785977192223072,
      "mae_dx": 0.0022066442761570215,
      "mae_dy": 0.003358451183885336,
      "pose_mae_dtheta": 0.06627602130174637,
      "pose_mae_dx": 0.031796734780073166,
      "pose_mae_dy": 0.030213559046387672,
      "pose_rmse_dtheta": 0.16041500866413116,
      "pose_rmse_dx": 0.08214161545038223,
      "pose_rmse_dy": 0.0732288733124733,
      "pose_rmse_mean": 0.10526183247566223,
      "rmse_dtheta": 0.021535973995923996,
      "rmse_dx": 0.005798408295959234,
      "rmse_dy": 0.008165242150425911,
      "rmse_mean": 0.011833208613097668,
      "rotation_flip": 0.006433823611587286,
      "sparse_tokens": 32073.0,
      "step": 3612,
      "turn_loss": 0.09576007723808289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.1678591339899647,
      "grad_norm": 0.5808777213096619,
      "learning_rate": 8.015407152327448e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.02992083504796028,
      "mae_dx": 0.013434921391308308,
      "mae_dy": 0.002047013957053423,
      "pose_mae_dtheta": 0.24932821094989777,
      "pose_mae_dx": 0.10263478755950928,
      "pose_mae_dy": 0.03411560878157616,
      "pose_rmse_dtheta": 0.5031581521034241,
      "pose_rmse_dx": 0.24284794926643372,
      "pose_rmse_dy": 0.09307125210762024,
      "pose_rmse_mean": 0.27969247102737427,
      "rmse_dtheta": 0.052172716706991196,
      "rmse_dx": 0.027304615825414658,
      "rmse_dy": 0.005027481820434332,
      "rmse_mean": 0.028168272227048874,
      "rotation_flip": 0.0058823530562222,
      "sparse_tokens": 7492.0,
      "step": 3613,
      "turn_loss": 0.2227334976196289,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.16790559375580746,
      "grad_norm": 0.7250188589096069,
      "learning_rate": 8.014352339641809e-06,
      "loss": 0.1764,
      "mae_dtheta": 0.02924640290439129,
      "mae_dx": 0.00785002764314413,
      "mae_dy": 0.0042342389933764935,
      "pose_mae_dtheta": 0.2300153523683548,
      "pose_mae_dx": 0.058180466294288635,
      "pose_mae_dy": 0.03886110335588455,
      "pose_rmse_dtheta": 0.4102225601673126,
      "pose_rmse_dx": 0.16948460042476654,
      "pose_rmse_dy": 0.08911918848752975,
      "pose_rmse_mean": 0.22294211387634277,
      "rmse_dtheta": 0.04733334481716156,
      "rmse_dx": 0.018409715965390205,
      "rmse_dy": 0.009527476504445076,
      "rmse_mean": 0.025090178474783897,
      "rotation_flip": 0.0185528751462698,
      "sparse_tokens": 9168.0,
      "step": 3614,
      "turn_loss": 0.24536803364753723,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.16795205352165024,
      "grad_norm": 0.5652022957801819,
      "learning_rate": 8.013297316160892e-06,
      "loss": 0.1358,
      "mae_dtheta": 0.009843412786722183,
      "mae_dx": 0.002691857051104307,
      "mae_dy": 0.001898022834211588,
      "pose_mae_dtheta": 0.06551739573478699,
      "pose_mae_dx": 0.02882181666791439,
      "pose_mae_dy": 0.02633395604789257,
      "pose_rmse_dtheta": 0.13874633610248566,
      "pose_rmse_dx": 0.07762672752141953,
      "pose_rmse_dy": 0.06049543246626854,
      "pose_rmse_mean": 0.092289499938488,
      "rmse_dtheta": 0.020141353830695152,
      "rmse_dx": 0.008416361175477505,
      "rmse_dy": 0.004211322404444218,
      "rmse_mean": 0.010923012159764767,
      "rotation_flip": 0.003418803447857499,
      "sparse_tokens": 32089.0,
      "step": 3615,
      "turn_loss": 0.08454197645187378,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.16799851328749302,
      "grad_norm": 0.5656076669692993,
      "learning_rate": 8.012242081958477e-06,
      "loss": 0.1252,
      "mae_dtheta": 0.013081450946629047,
      "mae_dx": 0.003366779303178191,
      "mae_dy": 0.00419958308339119,
      "pose_mae_dtheta": 0.09522005170583725,
      "pose_mae_dx": 0.03560733422636986,
      "pose_mae_dy": 0.03221682459115982,
      "pose_rmse_dtheta": 0.2285335659980774,
      "pose_rmse_dx": 0.09402060508728027,
      "pose_rmse_dy": 0.07395804673433304,
      "pose_rmse_mean": 0.13217073678970337,
      "rmse_dtheta": 0.02847430296242237,
      "rmse_dx": 0.008732563816010952,
      "rmse_dy": 0.010133227333426476,
      "rmse_mean": 0.01578003168106079,
      "rotation_flip": 0.0054901959374547005,
      "sparse_tokens": 32137.0,
      "step": 3616,
      "turn_loss": 0.13284845650196075,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.16804497305333582,
      "grad_norm": 0.7925274968147278,
      "learning_rate": 8.011186637108354e-06,
      "loss": 0.1462,
      "mae_dtheta": 0.013555179350078106,
      "mae_dx": 0.0031383056193590164,
      "mae_dy": 0.005792928859591484,
      "pose_mae_dtheta": 0.09568895399570465,
      "pose_mae_dx": 0.039838727563619614,
      "pose_mae_dy": 0.059554871171712875,
      "pose_rmse_dtheta": 0.2547231912612915,
      "pose_rmse_dx": 0.11134050041437149,
      "pose_rmse_dy": 0.21013498306274414,
      "pose_rmse_mean": 0.1920662373304367,
      "rmse_dtheta": 0.028889482840895653,
      "rmse_dx": 0.007939980365335941,
      "rmse_dy": 0.016029801219701767,
      "rmse_mean": 0.017619755119085312,
      "rotation_flip": 0.007705479394644499,
      "sparse_tokens": 32089.0,
      "step": 3617,
      "turn_loss": 0.1401081085205078,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1680914328191786,
      "grad_norm": 0.5498268604278564,
      "learning_rate": 8.010130981684337e-06,
      "loss": 0.1158,
      "mae_dtheta": 0.012713245116174221,
      "mae_dx": 0.002987104235216975,
      "mae_dy": 0.0035032671876251698,
      "pose_mae_dtheta": 0.09052157402038574,
      "pose_mae_dx": 0.03546261787414551,
      "pose_mae_dy": 0.03428654000163078,
      "pose_rmse_dtheta": 0.22180509567260742,
      "pose_rmse_dx": 0.09849459677934647,
      "pose_rmse_dy": 0.09773305058479309,
      "pose_rmse_mean": 0.1393442451953888,
      "rmse_dtheta": 0.027290139347314835,
      "rmse_dx": 0.00825001671910286,
      "rmse_dy": 0.008478478528559208,
      "rmse_mean": 0.014672878198325634,
      "rotation_flip": 0.0034144259989261627,
      "sparse_tokens": 32105.0,
      "step": 3618,
      "turn_loss": 0.11958178877830505,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18509.0,
      "epoch": 0.16813789258502138,
      "grad_norm": 0.6665372848510742,
      "learning_rate": 8.009075115760243e-06,
      "loss": 0.141,
      "mae_dtheta": 0.029315676540136337,
      "mae_dx": 0.009841496124863625,
      "mae_dy": 0.004891278222203255,
      "pose_mae_dtheta": 0.23132477700710297,
      "pose_mae_dx": 0.0773780569434166,
      "pose_mae_dy": 0.054139893501996994,
      "pose_rmse_dtheta": 0.4889211356639862,
      "pose_rmse_dx": 0.18292838335037231,
      "pose_rmse_dy": 0.12396924197673798,
      "pose_rmse_mean": 0.26527291536331177,
      "rmse_dtheta": 0.04984517768025398,
      "rmse_dx": 0.021670155227184296,
      "rmse_dy": 0.010209170170128345,
      "rmse_mean": 0.027241503819823265,
      "rotation_flip": 0.012765957042574883,
      "sparse_tokens": 15784.0,
      "step": 3619,
      "turn_loss": 0.22582627832889557,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.16818435235086415,
      "grad_norm": 0.6649920344352722,
      "learning_rate": 8.008019039409911e-06,
      "loss": 0.1141,
      "mae_dtheta": 0.021874509751796722,
      "mae_dx": 0.013123786076903343,
      "mae_dy": 0.005090349819511175,
      "pose_mae_dtheta": 0.1582888662815094,
      "pose_mae_dx": 0.0758831575512886,
      "pose_mae_dy": 0.08851995319128036,
      "pose_rmse_dtheta": 0.2844969928264618,
      "pose_rmse_dx": 0.1921035200357437,
      "pose_rmse_dy": 0.2277929186820984,
      "pose_rmse_mean": 0.23479782044887543,
      "rmse_dtheta": 0.03746374323964119,
      "rmse_dx": 0.02729734592139721,
      "rmse_dy": 0.01018450502306223,
      "rmse_mean": 0.024981863796710968,
      "rotation_flip": 0.015748031437397003,
      "sparse_tokens": 4932.0,
      "step": 3620,
      "turn_loss": 0.16403289139270782,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.16823081211670693,
      "grad_norm": 0.4280639588832855,
      "learning_rate": 8.006962752707193e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.012700913473963737,
      "mae_dx": 0.003187468508258462,
      "mae_dy": 0.0041177230887115,
      "pose_mae_dtheta": 0.0942440778017044,
      "pose_mae_dx": 0.03341272845864296,
      "pose_mae_dy": 0.03186606243252754,
      "pose_rmse_dtheta": 0.25725698471069336,
      "pose_rmse_dx": 0.09195151180028915,
      "pose_rmse_dy": 0.0775691345334053,
      "pose_rmse_mean": 0.14225921034812927,
      "rmse_dtheta": 0.029896745458245277,
      "rmse_dx": 0.00799795612692833,
      "rmse_dy": 0.010431774891912937,
      "rmse_mean": 0.01610882580280304,
      "rotation_flip": 0.0065645514987409115,
      "sparse_tokens": 32137.0,
      "step": 3621,
      "turn_loss": 0.12460071593523026,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.1682772718825497,
      "grad_norm": 1.0533660650253296,
      "learning_rate": 8.005906255725956e-06,
      "loss": 0.3205,
      "mae_dtheta": 0.02936229668557644,
      "mae_dx": 0.012194948270916939,
      "mae_dy": 0.0036806606221944094,
      "pose_mae_dtheta": 0.24600514769554138,
      "pose_mae_dx": 0.09880185127258301,
      "pose_mae_dy": 0.043690845370292664,
      "pose_rmse_dtheta": 0.4463077783584595,
      "pose_rmse_dx": 0.21582354605197906,
      "pose_rmse_dy": 0.10468929260969162,
      "pose_rmse_mean": 0.25560688972473145,
      "rmse_dtheta": 0.04668855667114258,
      "rmse_dx": 0.02385675348341465,
      "rmse_dy": 0.0074830022640526295,
      "rmse_mean": 0.026009438559412956,
      "rotation_flip": 0.01364764291793108,
      "sparse_tokens": 13162.0,
      "step": 3622,
      "turn_loss": 0.2440655678510666,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 32763.0,
      "epoch": 0.16832373164839248,
      "grad_norm": 0.5965752601623535,
      "learning_rate": 8.00484954854008e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.03915366530418396,
      "mae_dx": 0.011097910813987255,
      "mae_dy": 0.004040820058435202,
      "pose_mae_dtheta": 0.31590911746025085,
      "pose_mae_dx": 0.07653742283582687,
      "pose_mae_dy": 0.05198328197002411,
      "pose_rmse_dtheta": 0.5477639436721802,
      "pose_rmse_dx": 0.17634156346321106,
      "pose_rmse_dy": 0.14319616556167603,
      "pose_rmse_mean": 0.2891005575656891,
      "rmse_dtheta": 0.05818077176809311,
      "rmse_dx": 0.022735008969902992,
      "rmse_dy": 0.008837755769491196,
      "rmse_mean": 0.029917847365140915,
      "rotation_flip": 0.014897579327225685,
      "sparse_tokens": 27419.0,
      "step": 3623,
      "turn_loss": 0.2762385308742523,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 34388.0,
      "epoch": 0.16837019141423526,
      "grad_norm": 0.9086664915084839,
      "learning_rate": 8.003792631223463e-06,
      "loss": 0.1512,
      "mae_dtheta": 0.0408683717250824,
      "mae_dx": 0.012803726829588413,
      "mae_dy": 0.0036257377360016108,
      "pose_mae_dtheta": 0.3422034680843353,
      "pose_mae_dx": 0.09635145217180252,
      "pose_mae_dy": 0.039848972111940384,
      "pose_rmse_dtheta": 0.5593518018722534,
      "pose_rmse_dx": 0.21495486795902252,
      "pose_rmse_dy": 0.10368116199970245,
      "pose_rmse_mean": 0.2926626205444336,
      "rmse_dtheta": 0.05800819396972656,
      "rmse_dx": 0.024916470050811768,
      "rmse_dy": 0.007452645339071751,
      "rmse_mean": 0.030125770717859268,
      "rotation_flip": 0.0162357185035944,
      "sparse_tokens": 25217.0,
      "step": 3624,
      "turn_loss": 0.28017041087150574,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16841665118007806,
      "grad_norm": 0.522765576839447,
      "learning_rate": 8.002735503850016e-06,
      "loss": 0.1067,
      "mae_dtheta": 0.009840084239840508,
      "mae_dx": 0.0015589991817250848,
      "mae_dy": 0.0014222593745216727,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.522765576839447,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 168.4874267578125,
      "model/head/act_norm_mean": 127.61781881313131,
      "model/head/act_norm_min": 79.41911315917969,
      "model/head/act_over_embed": 87.70015986522758,
      "model/head/grad_frac": 0.09747520834207535,
      "model/head/grad_norm": 0.05095668509602547,
      "model/head/grad_zero_frac": 0.00014086866576690227,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6879636205808081,
      "model/head/update_ratio": 0.0008769791456870735,
      "model/head/weight_delta": 7.097093105316162,
      "model/head/weight_delta_rel": 0.12450403720140457,
      "model/head/weight_norm": 58.10478591918945,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41714996099472046,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4170828507085552,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41702479124069214,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28662323979808846,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10361572355031967,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05416673421859741,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5252592488789237,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001755538396537304,
      "model/modality_embedder.encoders.pose/weight_delta": 2.3217077255249023,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07585743069648743,
      "model/modality_embedder.encoders.pose/weight_norm": 30.85477066040039,
      "model/modality_embedder/grad_frac": 0.10361572355031967,
      "model/modality_embedder/grad_norm": 0.05416673421859741,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5252592488789237,
      "model/modality_embedder/update_ratio": 0.001755538396537304,
      "model/modality_embedder/weight_delta": 2.3217077255249023,
      "model/modality_embedder/weight_delta_rel": 0.07585743069648743,
      "model/modality_embedder/weight_norm": 30.85477066040039,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.59413146972656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.222387566137566,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.883888244628906,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.33306087116251,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08187329024076462,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04280053824186325,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015438320115208626,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.62544584274292,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.05923222750425339,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.72357177734375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 94.04690551757812,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.24680335097002,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.260441780090332,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.037048989231053,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08058834075927734,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04212880879640579,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014342408394441009,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.0525708198547363,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07110265642404556,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.373594284057617,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.75102996826172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.127091851050185,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.358095169067383,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.329200850024428,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08536498993635178,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04462587833404541,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001471725874580443,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.2002885341644287,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07388156652450562,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.322139739990234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.64776611328125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.884529822029823,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.423040390014648,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.536928677075146,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09919387847185135,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05185514688491821,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.00174905254971236,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.8770740032196045,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06414948403835297,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.647563934326172,
      "model/normalizer/grad_frac": 0.433278888463974,
      "model/normalizer/grad_norm": 0.22650328278541565,
      "model/normalizer/grad_zero_frac": 0.00018080597510561347,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002895974786952138,
      "model/normalizer/weight_delta": 3.9929206371307373,
      "model/normalizer/weight_delta_rel": 0.05142650753259659,
      "model/normalizer/weight_norm": 78.21314239501953,
      "pose_mae_dtheta": 0.07060998678207397,
      "pose_mae_dx": 0.018619250506162643,
      "pose_mae_dy": 0.02144317887723446,
      "pose_rmse_dtheta": 0.20944732427597046,
      "pose_rmse_dx": 0.04882994294166565,
      "pose_rmse_dy": 0.053404971957206726,
      "pose_rmse_mean": 0.10389407724142075,
      "rmse_dtheta": 0.025485748425126076,
      "rmse_dx": 0.005033810157328844,
      "rmse_dy": 0.0030152597464621067,
      "rmse_mean": 0.011178272776305676,
      "rotation_flip": 0.001932367100380361,
      "sparse_tokens": 32105.0,
      "step": 3625,
      "turn_loss": 0.07031036168336868,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21748.0,
      "epoch": 0.16846311094592084,
      "grad_norm": 0.45736217498779297,
      "learning_rate": 8.001678166493663e-06,
      "loss": 0.1291,
      "mae_dtheta": 0.02745169773697853,
      "mae_dx": 0.008888947777450085,
      "mae_dy": 0.004323053173720837,
      "pose_mae_dtheta": 0.21096637845039368,
      "pose_mae_dx": 0.07807861268520355,
      "pose_mae_dy": 0.05313674733042717,
      "pose_rmse_dtheta": 0.36202239990234375,
      "pose_rmse_dx": 0.17326299846172333,
      "pose_rmse_dy": 0.11494792997837067,
      "pose_rmse_mean": 0.21674445271492004,
      "rmse_dtheta": 0.04277075454592705,
      "rmse_dx": 0.01961972936987877,
      "rmse_dy": 0.007970972917973995,
      "rmse_mean": 0.02345382049679756,
      "rotation_flip": 0.010471204295754433,
      "sparse_tokens": 17871.0,
      "step": 3626,
      "turn_loss": 0.22277630865573883,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 35254.0,
      "epoch": 0.16850957071176362,
      "grad_norm": 0.5103750228881836,
      "learning_rate": 8.000620619228346e-06,
      "loss": 0.1421,
      "mae_dtheta": 0.03836461156606674,
      "mae_dx": 0.012695802375674248,
      "mae_dy": 0.006238470785319805,
      "pose_mae_dtheta": 0.32002586126327515,
      "pose_mae_dx": 0.11090265959501266,
      "pose_mae_dy": 0.07877448946237564,
      "pose_rmse_dtheta": 0.5608559250831604,
      "pose_rmse_dx": 0.25422510504722595,
      "pose_rmse_dy": 0.19001884758472443,
      "pose_rmse_mean": 0.3350332975387573,
      "rmse_dtheta": 0.057799626141786575,
      "rmse_dx": 0.026079542934894562,
      "rmse_dy": 0.014604606665670872,
      "rmse_mean": 0.03282792866230011,
      "rotation_flip": 0.009162303991615772,
      "sparse_tokens": 26578.0,
      "step": 3627,
      "turn_loss": 0.33359694480895996,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 17482.0,
      "epoch": 0.1685560304776064,
      "grad_norm": 0.5496359467506409,
      "learning_rate": 7.999562862128016e-06,
      "loss": 0.1337,
      "mae_dtheta": 0.02851220779120922,
      "mae_dx": 0.00801541842520237,
      "mae_dy": 0.005626125261187553,
      "pose_mae_dtheta": 0.22099530696868896,
      "pose_mae_dx": 0.043098460882902145,
      "pose_mae_dy": 0.06186670437455177,
      "pose_rmse_dtheta": 0.4184591770172119,
      "pose_rmse_dx": 0.11234255135059357,
      "pose_rmse_dy": 0.13595050573349,
      "pose_rmse_mean": 0.22225074470043182,
      "rmse_dtheta": 0.04609181731939316,
      "rmse_dx": 0.020562799647450447,
      "rmse_dy": 0.011841034516692162,
      "rmse_mean": 0.02616521716117859,
      "rotation_flip": 0.012482662685215473,
      "sparse_tokens": 14766.0,
      "step": 3628,
      "turn_loss": 0.21300208568572998,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.16860249024344917,
      "grad_norm": 0.524579644203186,
      "learning_rate": 7.998504895266646e-06,
      "loss": 0.138,
      "mae_dtheta": 0.03339953348040581,
      "mae_dx": 0.010819332674145699,
      "mae_dy": 0.004844306968152523,
      "pose_mae_dtheta": 0.2591789960861206,
      "pose_mae_dx": 0.08917025476694107,
      "pose_mae_dy": 0.04556454345583916,
      "pose_rmse_dtheta": 0.43075722455978394,
      "pose_rmse_dx": 0.2048576921224594,
      "pose_rmse_dy": 0.10039006173610687,
      "pose_rmse_mean": 0.24533501267433167,
      "rmse_dtheta": 0.04960796236991882,
      "rmse_dx": 0.022927651181817055,
      "rmse_dy": 0.010771076194941998,
      "rmse_mean": 0.027768895030021667,
      "rotation_flip": 0.010576923377811909,
      "sparse_tokens": 17179.0,
      "step": 3629,
      "turn_loss": 0.33010339736938477,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.16864895000929195,
      "grad_norm": 0.5475719571113586,
      "learning_rate": 7.99744671871822e-06,
      "loss": 0.1353,
      "mae_dtheta": 0.009413420222699642,
      "mae_dx": 0.0021009999327361584,
      "mae_dy": 0.0017960836412385106,
      "pose_mae_dtheta": 0.06210337206721306,
      "pose_mae_dx": 0.020951367914676666,
      "pose_mae_dy": 0.02354312501847744,
      "pose_rmse_dtheta": 0.11855866014957428,
      "pose_rmse_dx": 0.05168278142809868,
      "pose_rmse_dy": 0.05437617376446724,
      "pose_rmse_mean": 0.07487253844738007,
      "rmse_dtheta": 0.018765216693282127,
      "rmse_dx": 0.005952200852334499,
      "rmse_dy": 0.0036363659892231226,
      "rmse_mean": 0.009451260790228844,
      "rotation_flip": 0.0037678976077586412,
      "sparse_tokens": 32185.0,
      "step": 3630,
      "turn_loss": 0.07870829850435257,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.16869540977513472,
      "grad_norm": 0.4047190845012665,
      "learning_rate": 7.996388332556735e-06,
      "loss": 0.0991,
      "mae_dtheta": 0.009814170189201832,
      "mae_dx": 0.0017991227796301246,
      "mae_dy": 0.0021130007226020098,
      "pose_mae_dtheta": 0.06547016650438309,
      "pose_mae_dx": 0.018463589251041412,
      "pose_mae_dy": 0.02410670928657055,
      "pose_rmse_dtheta": 0.1760779172182083,
      "pose_rmse_dx": 0.05247281864285469,
      "pose_rmse_dy": 0.05757642537355423,
      "pose_rmse_mean": 0.09537571668624878,
      "rmse_dtheta": 0.023396726697683334,
      "rmse_dx": 0.006054799538105726,
      "rmse_dy": 0.005617929622530937,
      "rmse_mean": 0.011689819395542145,
      "rotation_flip": 0.006982543505728245,
      "sparse_tokens": 32073.0,
      "step": 3631,
      "turn_loss": 0.07397124916315079,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1687418695409775,
      "grad_norm": 0.5486828684806824,
      "learning_rate": 7.995329736856206e-06,
      "loss": 0.1037,
      "mae_dtheta": 0.011890728026628494,
      "mae_dx": 0.004213985521346331,
      "mae_dy": 0.005419780965894461,
      "pose_mae_dtheta": 0.0872550830245018,
      "pose_mae_dx": 0.05452005937695503,
      "pose_mae_dy": 0.0490361712872982,
      "pose_rmse_dtheta": 0.1931314915418625,
      "pose_rmse_dx": 0.15644465386867523,
      "pose_rmse_dy": 0.1453549861907959,
      "pose_rmse_mean": 0.1649770438671112,
      "rmse_dtheta": 0.02439842000603676,
      "rmse_dx": 0.011604239232838154,
      "rmse_dy": 0.014446800574660301,
      "rmse_mean": 0.016816487535834312,
      "rotation_flip": 0.01033484935760498,
      "sparse_tokens": 32089.0,
      "step": 3632,
      "turn_loss": 0.13467109203338623,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1687883293068203,
      "grad_norm": 0.5606099367141724,
      "learning_rate": 7.994270931690662e-06,
      "loss": 0.1532,
      "mae_dtheta": 0.010227618739008904,
      "mae_dx": 0.0019885108340531588,
      "mae_dy": 0.0023738828022032976,
      "pose_mae_dtheta": 0.07212693244218826,
      "pose_mae_dx": 0.025219429284334183,
      "pose_mae_dy": 0.032976433634757996,
      "pose_rmse_dtheta": 0.1537548154592514,
      "pose_rmse_dx": 0.06841493397951126,
      "pose_rmse_dy": 0.07417774200439453,
      "pose_rmse_mean": 0.0987825021147728,
      "rmse_dtheta": 0.020817838609218597,
      "rmse_dx": 0.006794029381126165,
      "rmse_dy": 0.004850237164646387,
      "rmse_mean": 0.010820701718330383,
      "rotation_flip": 0.005775577388703823,
      "sparse_tokens": 32073.0,
      "step": 3633,
      "turn_loss": 0.08352591842412949,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35903.0,
      "epoch": 0.16883478907266308,
      "grad_norm": 0.5373114347457886,
      "learning_rate": 7.993211917134145e-06,
      "loss": 0.1937,
      "mae_dtheta": 0.041001178324222565,
      "mae_dx": 0.011650108732283115,
      "mae_dy": 0.006112660747021437,
      "pose_mae_dtheta": 0.3497253656387329,
      "pose_mae_dx": 0.08959009498357773,
      "pose_mae_dy": 0.08117707818746567,
      "pose_rmse_dtheta": 0.562111496925354,
      "pose_rmse_dx": 0.17660406231880188,
      "pose_rmse_dy": 0.17169618606567383,
      "pose_rmse_mean": 0.30347058176994324,
      "rmse_dtheta": 0.05945461615920067,
      "rmse_dx": 0.023155836388468742,
      "rmse_dy": 0.010591704398393631,
      "rmse_mean": 0.031067386269569397,
      "rotation_flip": 0.010863660834729671,
      "sparse_tokens": 29377.0,
      "step": 3634,
      "turn_loss": 0.319814532995224,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.16888124883850586,
      "grad_norm": 0.5061050653457642,
      "learning_rate": 7.992152693260709e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.007936954498291016,
      "mae_dx": 0.001797700417228043,
      "mae_dy": 0.0027666494715958834,
      "pose_mae_dtheta": 0.05280895531177521,
      "pose_mae_dx": 0.02487874962389469,
      "pose_mae_dy": 0.024988634511828423,
      "pose_rmse_dtheta": 0.1078982949256897,
      "pose_rmse_dx": 0.06658120453357697,
      "pose_rmse_dy": 0.058139022439718246,
      "pose_rmse_mean": 0.07753951102495193,
      "rmse_dtheta": 0.017211057245731354,
      "rmse_dx": 0.004900726955384016,
      "rmse_dy": 0.006287870928645134,
      "rmse_mean": 0.009466552175581455,
      "rotation_flip": 0.0048436811193823814,
      "sparse_tokens": 32073.0,
      "step": 3635,
      "turn_loss": 0.0677579939365387,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.16892770860434864,
      "grad_norm": 0.4598477780818939,
      "learning_rate": 7.991093260144431e-06,
      "loss": 0.1313,
      "mae_dtheta": 0.0150053845718503,
      "mae_dx": 0.0028256536461412907,
      "mae_dy": 0.005186591763049364,
      "pose_mae_dtheta": 0.11026021838188171,
      "pose_mae_dx": 0.041947271674871445,
      "pose_mae_dy": 0.05760839581489563,
      "pose_rmse_dtheta": 0.23823630809783936,
      "pose_rmse_dx": 0.10807131230831146,
      "pose_rmse_dy": 0.16217303276062012,
      "pose_rmse_mean": 0.16949355602264404,
      "rmse_dtheta": 0.02920524589717388,
      "rmse_dx": 0.0073125907219946384,
      "rmse_dy": 0.011923453770577908,
      "rmse_mean": 0.016147097572684288,
      "rotation_flip": 0.006581494584679604,
      "sparse_tokens": 32041.0,
      "step": 3636,
      "turn_loss": 0.13393600285053253,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1689741683701914,
      "grad_norm": 0.5131847262382507,
      "learning_rate": 7.990033617859396e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.012763475999236107,
      "mae_dx": 0.002039222978055477,
      "mae_dy": 0.0025164508260786533,
      "pose_mae_dtheta": 0.0959344133734703,
      "pose_mae_dx": 0.02945229969918728,
      "pose_mae_dy": 0.03449375554919243,
      "pose_rmse_dtheta": 0.23800013959407806,
      "pose_rmse_dx": 0.08354582637548447,
      "pose_rmse_dy": 0.09269098192453384,
      "pose_rmse_mean": 0.1380789875984192,
      "rmse_dtheta": 0.027741320431232452,
      "rmse_dx": 0.00652295770123601,
      "rmse_dy": 0.005897767376154661,
      "rmse_mean": 0.013387348502874374,
      "rotation_flip": 0.0033238367177546024,
      "sparse_tokens": 32057.0,
      "step": 3637,
      "turn_loss": 0.0838860273361206,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1690206281360342,
      "grad_norm": 0.5279956459999084,
      "learning_rate": 7.988973766479706e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.009222360327839851,
      "mae_dx": 0.0018916636472567916,
      "mae_dy": 0.0016604032134637237,
      "pose_mae_dtheta": 0.0704895406961441,
      "pose_mae_dx": 0.014822004362940788,
      "pose_mae_dy": 0.01601715199649334,
      "pose_rmse_dtheta": 0.2551230192184448,
      "pose_rmse_dx": 0.04307113215327263,
      "pose_rmse_dy": 0.04294281080365181,
      "pose_rmse_mean": 0.11371232569217682,
      "rmse_dtheta": 0.02839336171746254,
      "rmse_dx": 0.006122923921793699,
      "rmse_dy": 0.006240664515644312,
      "rmse_mean": 0.01358565129339695,
      "rotation_flip": 0.009679821319878101,
      "sparse_tokens": 32089.0,
      "step": 3638,
      "turn_loss": 0.0659087672829628,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.16906708790187697,
      "grad_norm": 0.5726450681686401,
      "learning_rate": 7.987913706079476e-06,
      "loss": 0.1099,
      "mae_dtheta": 0.012845841236412525,
      "mae_dx": 0.0023212721571326256,
      "mae_dy": 0.0019251960329711437,
      "pose_mae_dtheta": 0.09565220773220062,
      "pose_mae_dx": 0.02472330816090107,
      "pose_mae_dy": 0.027348287403583527,
      "pose_rmse_dtheta": 0.25628936290740967,
      "pose_rmse_dx": 0.05672575905919075,
      "pose_rmse_dy": 0.06840325146913528,
      "pose_rmse_mean": 0.12713946402072906,
      "rmse_dtheta": 0.028651295229792595,
      "rmse_dx": 0.006403162144124508,
      "rmse_dy": 0.003959504421800375,
      "rmse_mean": 0.01300465315580368,
      "rotation_flip": 0.0014853323809802532,
      "sparse_tokens": 32201.0,
      "step": 3639,
      "turn_loss": 0.09679758548736572,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.16911354766771974,
      "grad_norm": 0.5003542304039001,
      "learning_rate": 7.986853436732835e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.02920428290963173,
      "mae_dx": 0.010122112929821014,
      "mae_dy": 0.0029337704181671143,
      "pose_mae_dtheta": 0.2424534112215042,
      "pose_mae_dx": 0.09174127131700516,
      "pose_mae_dy": 0.0362127348780632,
      "pose_rmse_dtheta": 0.4680839478969574,
      "pose_rmse_dx": 0.2044961005449295,
      "pose_rmse_dy": 0.09486449509859085,
      "pose_rmse_mean": 0.2558148503303528,
      "rmse_dtheta": 0.049292366951704025,
      "rmse_dx": 0.021679416298866272,
      "rmse_dy": 0.005843379534780979,
      "rmse_mean": 0.025605056434869766,
      "rotation_flip": 0.01315789483487606,
      "sparse_tokens": 13483.0,
      "step": 3640,
      "turn_loss": 0.21195022761821747,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.16916000743356255,
      "grad_norm": 0.5283528566360474,
      "learning_rate": 7.985792958513932e-06,
      "loss": 0.135,
      "mae_dtheta": 0.009744640439748764,
      "mae_dx": 0.0025885978247970343,
      "mae_dy": 0.0029322041664272547,
      "pose_mae_dtheta": 0.07178444415330887,
      "pose_mae_dx": 0.030107591301202774,
      "pose_mae_dy": 0.03397519886493683,
      "pose_rmse_dtheta": 0.17647182941436768,
      "pose_rmse_dx": 0.08565093576908112,
      "pose_rmse_dy": 0.09446157515048981,
      "pose_rmse_mean": 0.11886143684387207,
      "rmse_dtheta": 0.021424636244773865,
      "rmse_dx": 0.007766803726553917,
      "rmse_dy": 0.0071195270866155624,
      "rmse_mean": 0.012103656306862831,
      "rotation_flip": 0.0036781609524041414,
      "sparse_tokens": 32073.0,
      "step": 3641,
      "turn_loss": 0.10027363151311874,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.16920646719940532,
      "grad_norm": 0.599109947681427,
      "learning_rate": 7.984732271496925e-06,
      "loss": 0.1557,
      "mae_dtheta": 0.03164747357368469,
      "mae_dx": 0.010933982208371162,
      "mae_dy": 0.005576821975409985,
      "pose_mae_dtheta": 0.24795380234718323,
      "pose_mae_dx": 0.07601698487997055,
      "pose_mae_dy": 0.0691886618733406,
      "pose_rmse_dtheta": 0.45819100737571716,
      "pose_rmse_dx": 0.1801198273897171,
      "pose_rmse_dy": 0.14362122118473053,
      "pose_rmse_mean": 0.26064401865005493,
      "rmse_dtheta": 0.04832477122545242,
      "rmse_dx": 0.023801282048225403,
      "rmse_dy": 0.009975801222026348,
      "rmse_mean": 0.027367284521460533,
      "rotation_flip": 0.013524264097213745,
      "sparse_tokens": 22181.0,
      "step": 3642,
      "turn_loss": 0.23404745757579803,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1692529269652481,
      "grad_norm": 0.5093923807144165,
      "learning_rate": 7.983671375755986e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.011415654793381691,
      "mae_dx": 0.002162434160709381,
      "mae_dy": 0.003040534444153309,
      "pose_mae_dtheta": 0.07765930145978928,
      "pose_mae_dx": 0.027019206434488297,
      "pose_mae_dy": 0.03433893993496895,
      "pose_rmse_dtheta": 0.1741604506969452,
      "pose_rmse_dx": 0.07558946311473846,
      "pose_rmse_dy": 0.08726006746292114,
      "pose_rmse_mean": 0.1123366579413414,
      "rmse_dtheta": 0.02404177002608776,
      "rmse_dx": 0.00609740661457181,
      "rmse_dy": 0.006938133388757706,
      "rmse_mean": 0.012359103187918663,
      "rotation_flip": 0.0067214337177574635,
      "sparse_tokens": 32121.0,
      "step": 3643,
      "turn_loss": 0.10121796280145645,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64409.0,
      "epoch": 0.16929938673109088,
      "grad_norm": 0.4036969244480133,
      "learning_rate": 7.982610271365307e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.011711007915437222,
      "mae_dx": 0.0033402112312614918,
      "mae_dy": 0.004477363079786301,
      "pose_mae_dtheta": 0.09280788153409958,
      "pose_mae_dx": 0.038304973393678665,
      "pose_mae_dy": 0.04585688188672066,
      "pose_rmse_dtheta": 0.2426770031452179,
      "pose_rmse_dx": 0.11558205634355545,
      "pose_rmse_dy": 0.1167771965265274,
      "pose_rmse_mean": 0.15834543108940125,
      "rmse_dtheta": 0.026896895840764046,
      "rmse_dx": 0.011164148338139057,
      "rmse_dy": 0.013729722239077091,
      "rmse_mean": 0.017263589426875114,
      "rotation_flip": 0.005602241028100252,
      "sparse_tokens": 32009.0,
      "step": 3644,
      "turn_loss": 0.1358545869588852,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.16934584649693366,
      "grad_norm": 0.9862388372421265,
      "learning_rate": 7.981548958399092e-06,
      "loss": 0.255,
      "mae_dtheta": 0.047313425689935684,
      "mae_dx": 0.016142813488841057,
      "mae_dy": 0.006149847526103258,
      "pose_mae_dtheta": 0.37671026587486267,
      "pose_mae_dx": 0.11515385657548904,
      "pose_mae_dy": 0.054457470774650574,
      "pose_rmse_dtheta": 0.5905874967575073,
      "pose_rmse_dx": 0.22944976389408112,
      "pose_rmse_dy": 0.11876896768808365,
      "pose_rmse_mean": 0.31293541193008423,
      "rmse_dtheta": 0.06513611227273941,
      "rmse_dx": 0.028203759342432022,
      "rmse_dy": 0.012328305281698704,
      "rmse_mean": 0.03522272780537605,
      "rotation_flip": 0.015267175622284412,
      "sparse_tokens": 6617.0,
      "step": 3645,
      "turn_loss": 0.3447782099246979,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.16939230626277643,
      "grad_norm": 0.4500436782836914,
      "learning_rate": 7.980487436931558e-06,
      "loss": 0.0991,
      "mae_dtheta": 0.013471540063619614,
      "mae_dx": 0.002271959325298667,
      "mae_dy": 0.0022665499709546566,
      "pose_mae_dtheta": 0.09596843272447586,
      "pose_mae_dx": 0.024492980912327766,
      "pose_mae_dy": 0.027614125981926918,
      "pose_rmse_dtheta": 0.2544756233692169,
      "pose_rmse_dx": 0.06102992966771126,
      "pose_rmse_dy": 0.06161770597100258,
      "pose_rmse_mean": 0.12570776045322418,
      "rmse_dtheta": 0.02858859673142433,
      "rmse_dx": 0.007083723787218332,
      "rmse_dy": 0.004467716906219721,
      "rmse_mean": 0.013380013406276703,
      "rotation_flip": 0.005430566146969795,
      "sparse_tokens": 32105.0,
      "step": 3646,
      "turn_loss": 0.09571538120508194,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1694387660286192,
      "grad_norm": 0.3458544611930847,
      "learning_rate": 7.979425707036936e-06,
      "loss": 0.0905,
      "mae_dtheta": 0.011340820230543613,
      "mae_dx": 0.0019948577973991632,
      "mae_dy": 0.0019790036603808403,
      "pose_mae_dtheta": 0.07730472087860107,
      "pose_mae_dx": 0.02660309709608555,
      "pose_mae_dy": 0.02600869908928871,
      "pose_rmse_dtheta": 0.2128441333770752,
      "pose_rmse_dx": 0.07379470765590668,
      "pose_rmse_dy": 0.059291016310453415,
      "pose_rmse_mean": 0.1153099536895752,
      "rmse_dtheta": 0.025495849549770355,
      "rmse_dx": 0.006914788857102394,
      "rmse_dy": 0.004177450202405453,
      "rmse_mean": 0.012196029536426067,
      "rotation_flip": 0.0020627062767744064,
      "sparse_tokens": 32073.0,
      "step": 3647,
      "turn_loss": 0.07819908112287521,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.16948522579446199,
      "grad_norm": 0.5732300281524658,
      "learning_rate": 7.978363768789477e-06,
      "loss": 0.1187,
      "mae_dtheta": 0.021858885884284973,
      "mae_dx": 0.00388686778023839,
      "mae_dy": 0.003184250323101878,
      "pose_mae_dtheta": 0.17043040692806244,
      "pose_mae_dx": 0.030593395233154297,
      "pose_mae_dy": 0.04192110896110535,
      "pose_rmse_dtheta": 0.3841214179992676,
      "pose_rmse_dx": 0.08106893301010132,
      "pose_rmse_dy": 0.09830234199762344,
      "pose_rmse_mean": 0.18783091008663177,
      "rmse_dtheta": 0.0396588109433651,
      "rmse_dx": 0.0113702192902565,
      "rmse_dy": 0.006348071154206991,
      "rmse_mean": 0.019125699996948242,
      "rotation_flip": 0.007894736714661121,
      "sparse_tokens": 16397.0,
      "step": 3648,
      "turn_loss": 0.14046752452850342,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.16953168556030476,
      "grad_norm": 0.31020426750183105,
      "learning_rate": 7.97730162226344e-06,
      "loss": 0.0916,
      "mae_dtheta": 0.007750320248305798,
      "mae_dx": 0.0016098497435450554,
      "mae_dy": 0.0005210256786085665,
      "pose_mae_dtheta": 0.05654619261622429,
      "pose_mae_dx": 0.01355776097625494,
      "pose_mae_dy": 0.0077873398549854755,
      "pose_rmse_dtheta": 0.22352392971515656,
      "pose_rmse_dx": 0.03583987057209015,
      "pose_rmse_dy": 0.024932146072387695,
      "pose_rmse_mean": 0.0947653204202652,
      "rmse_dtheta": 0.027021389454603195,
      "rmse_dx": 0.005077671725302935,
      "rmse_dy": 0.0013768936041742563,
      "rmse_mean": 0.011158651672303677,
      "rotation_flip": 0.0007122507086023688,
      "sparse_tokens": 32137.0,
      "step": 3649,
      "turn_loss": 0.046316444873809814,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.16957814532614757,
      "grad_norm": 0.46019846200942993,
      "learning_rate": 7.976239267533103e-06,
      "loss": 0.0732,
      "mae_dtheta": 0.010809298604726791,
      "mae_dx": 0.0038467312697321177,
      "mae_dy": 0.0030266509857028723,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4601985216140747,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.18492126464844,
      "model/head/act_norm_mean": 109.74050071022727,
      "model/head/act_norm_min": 44.961490631103516,
      "model/head/act_over_embed": 75.41469949482288,
      "model/head/grad_frac": 0.07924823462963104,
      "model/head/grad_norm": 0.036469921469688416,
      "model/head/grad_zero_frac": 0.0001830658147810027,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7007575757575758,
      "model/head/update_ratio": 0.0006275983760133386,
      "model/head/weight_delta": 7.119253635406494,
      "model/head/weight_delta_rel": 0.12489279359579086,
      "model/head/weight_norm": 58.110286712646484,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41729941964149475,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41719776688657734,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41711652278900146,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2867022112714875,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10463670641183853,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04815365746617317,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5218997454751131,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015605725347995758,
      "model/modality_embedder.encoders.pose/weight_delta": 2.3321568965911865,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07619883120059967,
      "model/modality_embedder.encoders.pose/weight_norm": 30.85640525817871,
      "model/modality_embedder/grad_frac": 0.10463670641183853,
      "model/modality_embedder/grad_norm": 0.04815365746617317,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5218997454751131,
      "model/modality_embedder/update_ratio": 0.0015605725347995758,
      "model/modality_embedder/weight_delta": 2.3321568965911865,
      "model/modality_embedder/weight_delta_rel": 0.07619883120059967,
      "model/modality_embedder/weight_norm": 30.85640525817871,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.06798553466797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.46611702340869,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.983837127685547,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.126135311735347,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.056019268929958344,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.025779984891414642,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009298673830926418,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.6338053941726685,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.059536855667829514,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.724367141723633,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.52761840820312,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.459638548180216,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.377108573913574,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.808892605053405,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05580214038491249,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.025680063292384148,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008741854690015316,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.0629992485046387,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07146390527486801,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.37598991394043,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.9981689453125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.309025272566938,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.268850326538086,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.07980847628326,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05697764828801155,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.026221029460430145,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008646661881357431,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.211862802505493,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07427021116018295,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.325031280517578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.69186401367188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.197370530703864,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.640920639038086,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.3774970166418,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07367605715990067,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03390561416745186,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011435203487053514,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.8869397640228271,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06448664516210556,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.650205612182617,
      "model/normalizer/grad_frac": 0.22907176613807678,
      "model/normalizer/grad_norm": 0.10541848838329315,
      "model/normalizer/grad_zero_frac": 0.00018435118545312434,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0013477833708748221,
      "model/normalizer/weight_delta": 4.013675689697266,
      "model/normalizer/weight_delta_rel": 0.05169381946325302,
      "model/normalizer/weight_norm": 78.21619415283203,
      "pose_mae_dtheta": 0.07970581203699112,
      "pose_mae_dx": 0.0361727736890316,
      "pose_mae_dy": 0.03606948256492615,
      "pose_rmse_dtheta": 0.20043058693408966,
      "pose_rmse_dx": 0.10651101171970367,
      "pose_rmse_dy": 0.11582183837890625,
      "pose_rmse_mean": 0.14092114567756653,
      "rmse_dtheta": 0.024151060730218887,
      "rmse_dx": 0.011976251378655434,
      "rmse_dy": 0.009172805584967136,
      "rmse_mean": 0.015100039541721344,
      "rotation_flip": 0.0021987687796354294,
      "sparse_tokens": 32089.0,
      "step": 3650,
      "turn_loss": 0.1172562837600708,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28785.0,
      "epoch": 0.16962460509199034,
      "grad_norm": 0.5858917832374573,
      "learning_rate": 7.975176704672757e-06,
      "loss": 0.1677,
      "mae_dtheta": 0.03626295551657677,
      "mae_dx": 0.012006187811493874,
      "mae_dy": 0.008008520118892193,
      "pose_mae_dtheta": 0.3131668269634247,
      "pose_mae_dx": 0.11247808486223221,
      "pose_mae_dy": 0.12643085420131683,
      "pose_rmse_dtheta": 0.5302513241767883,
      "pose_rmse_dx": 0.2568068504333496,
      "pose_rmse_dy": 0.2727726399898529,
      "pose_rmse_mean": 0.35327693819999695,
      "rmse_dtheta": 0.05340578407049179,
      "rmse_dx": 0.025535140186548233,
      "rmse_dy": 0.014109084382653236,
      "rmse_mean": 0.031016670167446136,
      "rotation_flip": 0.014705882407724857,
      "sparse_tokens": 23341.0,
      "step": 3651,
      "turn_loss": 0.2868538200855255,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.16967106485783312,
      "grad_norm": 0.3678440451622009,
      "learning_rate": 7.974113933756708e-06,
      "loss": 0.0733,
      "mae_dtheta": 0.008334210142493248,
      "mae_dx": 0.0018462094012647867,
      "mae_dy": 0.0017993859946727753,
      "pose_mae_dtheta": 0.060649845749139786,
      "pose_mae_dx": 0.021720683202147484,
      "pose_mae_dy": 0.024368766695261,
      "pose_rmse_dtheta": 0.16168545186519623,
      "pose_rmse_dx": 0.06026410683989525,
      "pose_rmse_dy": 0.0634356290102005,
      "pose_rmse_mean": 0.09512840211391449,
      "rmse_dtheta": 0.021484961733222008,
      "rmse_dx": 0.006542874965816736,
      "rmse_dy": 0.004539054352790117,
      "rmse_mean": 0.010855630040168762,
      "rotation_flip": 0.0032786885276436806,
      "sparse_tokens": 32057.0,
      "step": 3652,
      "turn_loss": 0.06987584382295609,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.1697175246236759,
      "grad_norm": 0.5010879039764404,
      "learning_rate": 7.973050954859274e-06,
      "loss": 0.1252,
      "mae_dtheta": 0.027377262711524963,
      "mae_dx": 0.009516743943095207,
      "mae_dy": 0.004422004334628582,
      "pose_mae_dtheta": 0.2439146488904953,
      "pose_mae_dx": 0.06850066035985947,
      "pose_mae_dy": 0.06978470832109451,
      "pose_rmse_dtheta": 0.43373677134513855,
      "pose_rmse_dx": 0.15279194712638855,
      "pose_rmse_dy": 0.16442182660102844,
      "pose_rmse_mean": 0.250316858291626,
      "rmse_dtheta": 0.04528902843594551,
      "rmse_dx": 0.020189344882965088,
      "rmse_dy": 0.009646161459386349,
      "rmse_mean": 0.02504151128232479,
      "rotation_flip": 0.01326259970664978,
      "sparse_tokens": 8461.0,
      "step": 3653,
      "turn_loss": 0.19435353577136993,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.16976398438951867,
      "grad_norm": 0.37875211238861084,
      "learning_rate": 7.971987768054791e-06,
      "loss": 0.0737,
      "mae_dtheta": 0.006303463596850634,
      "mae_dx": 0.0016392944380640984,
      "mae_dy": 0.0015721820527687669,
      "pose_mae_dtheta": 0.0436922051012516,
      "pose_mae_dx": 0.018864557147026062,
      "pose_mae_dy": 0.019118232652544975,
      "pose_rmse_dtheta": 0.12698939442634583,
      "pose_rmse_dx": 0.0544113852083683,
      "pose_rmse_dy": 0.04684906825423241,
      "pose_rmse_mean": 0.07608328759670258,
      "rmse_dtheta": 0.017885427922010422,
      "rmse_dx": 0.005382065195590258,
      "rmse_dy": 0.004623319488018751,
      "rmse_mean": 0.009296937845647335,
      "rotation_flip": 0.003006614511832595,
      "sparse_tokens": 32057.0,
      "step": 3654,
      "turn_loss": 0.054654911160469055,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.16981044415536145,
      "grad_norm": 0.42344239354133606,
      "learning_rate": 7.970924373417608e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.016054978594183922,
      "mae_dx": 0.002584136789664626,
      "mae_dy": 0.003792559029534459,
      "pose_mae_dtheta": 0.1051243469119072,
      "pose_mae_dx": 0.03159613907337189,
      "pose_mae_dy": 0.03885503113269806,
      "pose_rmse_dtheta": 0.23572203516960144,
      "pose_rmse_dx": 0.07296507805585861,
      "pose_rmse_dy": 0.08802337944507599,
      "pose_rmse_mean": 0.13223683834075928,
      "rmse_dtheta": 0.030973190441727638,
      "rmse_dx": 0.007903803139925003,
      "rmse_dy": 0.008780863136053085,
      "rmse_mean": 0.01588595286011696,
      "rotation_flip": 0.006028131116181612,
      "sparse_tokens": 32089.0,
      "step": 3655,
      "turn_loss": 0.15388642251491547,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20710.0,
      "epoch": 0.16985690392120423,
      "grad_norm": 0.489221453666687,
      "learning_rate": 7.96986077102209e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.030605923384428024,
      "mae_dx": 0.014301848597824574,
      "mae_dy": 0.006011048331856728,
      "pose_mae_dtheta": 0.23496849834918976,
      "pose_mae_dx": 0.10811978578567505,
      "pose_mae_dy": 0.07567566633224487,
      "pose_rmse_dtheta": 0.3761810064315796,
      "pose_rmse_dx": 0.23399287462234497,
      "pose_rmse_dy": 0.15650899708271027,
      "pose_rmse_mean": 0.255560964345932,
      "rmse_dtheta": 0.04565780609846115,
      "rmse_dx": 0.02807874046266079,
      "rmse_dy": 0.010551371611654758,
      "rmse_mean": 0.028095973655581474,
      "rotation_flip": 0.011183597147464752,
      "sparse_tokens": 16925.0,
      "step": 3656,
      "turn_loss": 0.2646113932132721,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 36874.0,
      "epoch": 0.169903363687047,
      "grad_norm": 0.4723643958568573,
      "learning_rate": 7.968796960942614e-06,
      "loss": 0.1513,
      "mae_dtheta": 0.034420501440763474,
      "mae_dx": 0.011403396725654602,
      "mae_dy": 0.005258567165583372,
      "pose_mae_dtheta": 0.2737247943878174,
      "pose_mae_dx": 0.07870637625455856,
      "pose_mae_dy": 0.06527581810951233,
      "pose_rmse_dtheta": 0.4781161844730377,
      "pose_rmse_dx": 0.17934034764766693,
      "pose_rmse_dy": 0.14480231702327728,
      "pose_rmse_mean": 0.26741963624954224,
      "rmse_dtheta": 0.05198642611503601,
      "rmse_dx": 0.023576660081744194,
      "rmse_dy": 0.010065951384603977,
      "rmse_mean": 0.02854301407933235,
      "rotation_flip": 0.007705008145421743,
      "sparse_tokens": 28431.0,
      "step": 3657,
      "turn_loss": 0.29862624406814575,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.1699498234528898,
      "grad_norm": 0.5493505597114563,
      "learning_rate": 7.967732943253572e-06,
      "loss": 0.1745,
      "mae_dtheta": 0.034567296504974365,
      "mae_dx": 0.015649966895580292,
      "mae_dy": 0.00639566732570529,
      "pose_mae_dtheta": 0.2587258219718933,
      "pose_mae_dx": 0.14705157279968262,
      "pose_mae_dy": 0.06837619096040726,
      "pose_rmse_dtheta": 0.45190975069999695,
      "pose_rmse_dx": 0.2999383509159088,
      "pose_rmse_dy": 0.16044840216636658,
      "pose_rmse_mean": 0.30409884452819824,
      "rmse_dtheta": 0.052255794405937195,
      "rmse_dx": 0.029487118124961853,
      "rmse_dy": 0.012243066914379597,
      "rmse_mean": 0.03132866322994232,
      "rotation_flip": 0.01552795059978962,
      "sparse_tokens": 10955.0,
      "step": 3658,
      "turn_loss": 0.3366581201553345,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.16999628321873259,
      "grad_norm": 0.5797703266143799,
      "learning_rate": 7.966668718029372e-06,
      "loss": 0.1441,
      "mae_dtheta": 0.02203916199505329,
      "mae_dx": 0.00823001004755497,
      "mae_dy": 0.0029039173386991024,
      "pose_mae_dtheta": 0.15395218133926392,
      "pose_mae_dx": 0.05836993083357811,
      "pose_mae_dy": 0.028537346050143242,
      "pose_rmse_dtheta": 0.32318446040153503,
      "pose_rmse_dx": 0.16708621382713318,
      "pose_rmse_dy": 0.08790222555398941,
      "pose_rmse_mean": 0.1927243173122406,
      "rmse_dtheta": 0.04034058377146721,
      "rmse_dx": 0.0200695488601923,
      "rmse_dy": 0.006440989673137665,
      "rmse_mean": 0.022283708676695824,
      "rotation_flip": 0.010582010261714458,
      "sparse_tokens": 11926.0,
      "step": 3659,
      "turn_loss": 0.20236283540725708,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.17004274298457536,
      "grad_norm": 0.5102499127388,
      "learning_rate": 7.965604285344437e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.01173898484557867,
      "mae_dx": 0.0026030021253973246,
      "mae_dy": 0.0033845873549580574,
      "pose_mae_dtheta": 0.08796676993370056,
      "pose_mae_dx": 0.03078455850481987,
      "pose_mae_dy": 0.03519925847649574,
      "pose_rmse_dtheta": 0.20901566743850708,
      "pose_rmse_dx": 0.08691190183162689,
      "pose_rmse_dy": 0.08212428539991379,
      "pose_rmse_mean": 0.12601730227470398,
      "rmse_dtheta": 0.025016456842422485,
      "rmse_dx": 0.00839400477707386,
      "rmse_dy": 0.009191862307488918,
      "rmse_mean": 0.01420077495276928,
      "rotation_flip": 0.00646464666351676,
      "sparse_tokens": 32073.0,
      "step": 3660,
      "turn_loss": 0.11222981661558151,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.17008920275041814,
      "grad_norm": 0.498322069644928,
      "learning_rate": 7.964539645273204e-06,
      "loss": 0.1512,
      "mae_dtheta": 0.04112689569592476,
      "mae_dx": 0.013697545975446701,
      "mae_dy": 0.00521235354244709,
      "pose_mae_dtheta": 0.3173445463180542,
      "pose_mae_dx": 0.11101695895195007,
      "pose_mae_dy": 0.06728210300207138,
      "pose_rmse_dtheta": 0.538820207118988,
      "pose_rmse_dx": 0.23488125205039978,
      "pose_rmse_dy": 0.18436074256896973,
      "pose_rmse_mean": 0.3193540573120117,
      "rmse_dtheta": 0.0596906840801239,
      "rmse_dx": 0.02681850455701351,
      "rmse_dy": 0.011024325154721737,
      "rmse_mean": 0.03251117467880249,
      "rotation_flip": 0.012609117664396763,
      "sparse_tokens": 15138.0,
      "step": 3661,
      "turn_loss": 0.3634919226169586,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.17013566251626092,
      "grad_norm": 0.42912206053733826,
      "learning_rate": 7.96347479789012e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.02865665592253208,
      "mae_dx": 0.01125563308596611,
      "mae_dy": 0.003121238900348544,
      "pose_mae_dtheta": 0.2454277127981186,
      "pose_mae_dx": 0.07612981647253036,
      "pose_mae_dy": 0.043303921818733215,
      "pose_rmse_dtheta": 0.4687800407409668,
      "pose_rmse_dx": 0.1740775853395462,
      "pose_rmse_dy": 0.11209617555141449,
      "pose_rmse_mean": 0.2516512870788574,
      "rmse_dtheta": 0.04772458225488663,
      "rmse_dx": 0.023451365530490875,
      "rmse_dy": 0.006109035573899746,
      "rmse_mean": 0.025761662051081657,
      "rotation_flip": 0.00968992244452238,
      "sparse_tokens": 9474.0,
      "step": 3662,
      "turn_loss": 0.2413344383239746,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 14621.0,
      "epoch": 0.1701821222821037,
      "grad_norm": 0.5533222556114197,
      "learning_rate": 7.962409743269654e-06,
      "loss": 0.0955,
      "mae_dtheta": 0.03576182574033737,
      "mae_dx": 0.015590415336191654,
      "mae_dy": 0.005712855141609907,
      "pose_mae_dtheta": 0.2637651264667511,
      "pose_mae_dx": 0.12834936380386353,
      "pose_mae_dy": 0.06084514036774635,
      "pose_rmse_dtheta": 0.4466807246208191,
      "pose_rmse_dx": 0.2666068971157074,
      "pose_rmse_dy": 0.13386936485767365,
      "pose_rmse_mean": 0.2823856472969055,
      "rmse_dtheta": 0.05193348973989487,
      "rmse_dx": 0.028136037290096283,
      "rmse_dy": 0.010383088141679764,
      "rmse_mean": 0.030150871723890305,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 11893.0,
      "step": 3663,
      "turn_loss": 0.2493695169687271,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.17022858204794647,
      "grad_norm": 0.5921292304992676,
      "learning_rate": 7.961344481486285e-06,
      "loss": 0.1175,
      "mae_dtheta": 0.03214143216609955,
      "mae_dx": 0.010809363797307014,
      "mae_dy": 0.007367326878011227,
      "pose_mae_dtheta": 0.26860111951828003,
      "pose_mae_dx": 0.0709758847951889,
      "pose_mae_dy": 0.07205937057733536,
      "pose_rmse_dtheta": 0.5380704998970032,
      "pose_rmse_dx": 0.14545221626758575,
      "pose_rmse_dy": 0.1890011578798294,
      "pose_rmse_mean": 0.290841281414032,
      "rmse_dtheta": 0.054182685911655426,
      "rmse_dx": 0.020761540159583092,
      "rmse_dy": 0.01691221445798874,
      "rmse_mean": 0.030618814751505852,
      "rotation_flip": 0.020958084613084793,
      "sparse_tokens": 5783.0,
      "step": 3664,
      "turn_loss": 0.29215380549430847,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.17027504181378925,
      "grad_norm": 0.46702688932418823,
      "learning_rate": 7.960279012614508e-06,
      "loss": 0.1389,
      "mae_dtheta": 0.008923781104385853,
      "mae_dx": 0.0018844238948076963,
      "mae_dy": 0.0017103012651205063,
      "pose_mae_dtheta": 0.0648055449128151,
      "pose_mae_dx": 0.020269501954317093,
      "pose_mae_dy": 0.022049831226468086,
      "pose_rmse_dtheta": 0.17635735869407654,
      "pose_rmse_dx": 0.05473286285996437,
      "pose_rmse_dy": 0.06193973124027252,
      "pose_rmse_mean": 0.09767665714025497,
      "rmse_dtheta": 0.02278898097574711,
      "rmse_dx": 0.006650537718087435,
      "rmse_dy": 0.004744675941765308,
      "rmse_mean": 0.01139473170042038,
      "rotation_flip": 0.002497502602636814,
      "sparse_tokens": 32105.0,
      "step": 3665,
      "turn_loss": 0.07260672003030777,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.17032150157963205,
      "grad_norm": 0.7041921615600586,
      "learning_rate": 7.959213336728828e-06,
      "loss": 0.1328,
      "mae_dtheta": 0.033044006675481796,
      "mae_dx": 0.019287925213575363,
      "mae_dy": 0.005266203079372644,
      "pose_mae_dtheta": 0.2768973112106323,
      "pose_mae_dx": 0.16115370392799377,
      "pose_mae_dy": 0.10094746947288513,
      "pose_rmse_dtheta": 0.4559142291545868,
      "pose_rmse_dx": 0.31404632329940796,
      "pose_rmse_dy": 0.18435856699943542,
      "pose_rmse_mean": 0.31810638308525085,
      "rmse_dtheta": 0.04689684882760048,
      "rmse_dx": 0.034732721745967865,
      "rmse_dy": 0.00770927406847477,
      "rmse_mean": 0.029779616743326187,
      "rotation_flip": 0.013029315508902073,
      "sparse_tokens": 6388.0,
      "step": 3666,
      "turn_loss": 0.25694477558135986,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17036796134547483,
      "grad_norm": 0.43972721695899963,
      "learning_rate": 7.958147453903773e-06,
      "loss": 0.1019,
      "mae_dtheta": 0.014001578092575073,
      "mae_dx": 0.0018960260786116123,
      "mae_dy": 0.0035929817240685225,
      "pose_mae_dtheta": 0.09468411654233932,
      "pose_mae_dx": 0.02914520539343357,
      "pose_mae_dy": 0.041813526302576065,
      "pose_rmse_dtheta": 0.21518060564994812,
      "pose_rmse_dx": 0.07140059769153595,
      "pose_rmse_dy": 0.09950191527605057,
      "pose_rmse_mean": 0.12869438529014587,
      "rmse_dtheta": 0.026598570868372917,
      "rmse_dx": 0.005789282266050577,
      "rmse_dy": 0.00787102896720171,
      "rmse_mean": 0.013419627211987972,
      "rotation_flip": 0.006206896621733904,
      "sparse_tokens": 32089.0,
      "step": 3667,
      "turn_loss": 0.1078759953379631,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1704144211113176,
      "grad_norm": 0.6367243528366089,
      "learning_rate": 7.957081364213878e-06,
      "loss": 0.1881,
      "mae_dtheta": 0.012372667901217937,
      "mae_dx": 0.002064397791400552,
      "mae_dy": 0.002790403086692095,
      "pose_mae_dtheta": 0.0865107998251915,
      "pose_mae_dx": 0.025447914376854897,
      "pose_mae_dy": 0.030052365735173225,
      "pose_rmse_dtheta": 0.20878736674785614,
      "pose_rmse_dx": 0.05502341687679291,
      "pose_rmse_dy": 0.06471844017505646,
      "pose_rmse_mean": 0.10950975120067596,
      "rmse_dtheta": 0.02521795779466629,
      "rmse_dx": 0.0063659376464784145,
      "rmse_dy": 0.006607618648558855,
      "rmse_mean": 0.012730504386126995,
      "rotation_flip": 0.00402193795889616,
      "sparse_tokens": 32137.0,
      "step": 3668,
      "turn_loss": 0.11315640807151794,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27902.0,
      "epoch": 0.17046088087716038,
      "grad_norm": 0.6530481576919556,
      "learning_rate": 7.956015067733695e-06,
      "loss": 0.1824,
      "mae_dtheta": 0.030002404004335403,
      "mae_dx": 0.010238020680844784,
      "mae_dy": 0.0071462588384747505,
      "pose_mae_dtheta": 0.22329877316951752,
      "pose_mae_dx": 0.09419596195220947,
      "pose_mae_dy": 0.07977700233459473,
      "pose_rmse_dtheta": 0.37023454904556274,
      "pose_rmse_dx": 0.19471347332000732,
      "pose_rmse_dy": 0.19851182401180267,
      "pose_rmse_mean": 0.254486620426178,
      "rmse_dtheta": 0.04585516080260277,
      "rmse_dx": 0.02100321464240551,
      "rmse_dy": 0.015107628889381886,
      "rmse_mean": 0.02732200175523758,
      "rotation_flip": 0.015003751032054424,
      "sparse_tokens": 24508.0,
      "step": 3669,
      "turn_loss": 0.2717916667461395,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.17050734064300316,
      "grad_norm": 0.49605950713157654,
      "learning_rate": 7.954948564537795e-06,
      "loss": 0.0855,
      "mae_dtheta": 0.007454570848494768,
      "mae_dx": 0.0013192555634304881,
      "mae_dy": 0.0014837159542366862,
      "pose_mae_dtheta": 0.053173743188381195,
      "pose_mae_dx": 0.015306069515645504,
      "pose_mae_dy": 0.017228445038199425,
      "pose_rmse_dtheta": 0.1647702008485794,
      "pose_rmse_dx": 0.03790208697319031,
      "pose_rmse_dy": 0.04170551151037216,
      "pose_rmse_mean": 0.08145926892757416,
      "rmse_dtheta": 0.019773680716753006,
      "rmse_dx": 0.0039931973442435265,
      "rmse_dy": 0.0033321240916848183,
      "rmse_mean": 0.009033001028001308,
      "rotation_flip": 0.004541325848549604,
      "sparse_tokens": 32121.0,
      "step": 3670,
      "turn_loss": 0.05738013610243797,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.17055380040884593,
      "grad_norm": 0.5672765970230103,
      "learning_rate": 7.953881854700754e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.03606554865837097,
      "mae_dx": 0.017901675775647163,
      "mae_dy": 0.008031128905713558,
      "pose_mae_dtheta": 0.2880644202232361,
      "pose_mae_dx": 0.14663545787334442,
      "pose_mae_dy": 0.11687690019607544,
      "pose_rmse_dtheta": 0.4897008538246155,
      "pose_rmse_dx": 0.3025777041912079,
      "pose_rmse_dy": 0.2635761797428131,
      "pose_rmse_mean": 0.35195156931877136,
      "rmse_dtheta": 0.05239235609769821,
      "rmse_dx": 0.0318521186709404,
      "rmse_dy": 0.014516443945467472,
      "rmse_mean": 0.03292030841112137,
      "rotation_flip": 0.030562346801161766,
      "sparse_tokens": 13205.0,
      "step": 3671,
      "turn_loss": 0.2774127423763275,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1706002601746887,
      "grad_norm": 0.5306180715560913,
      "learning_rate": 7.952814938297169e-06,
      "loss": 0.1293,
      "mae_dtheta": 0.009544079191982746,
      "mae_dx": 0.0012037192936986685,
      "mae_dy": 0.0019687486346811056,
      "pose_mae_dtheta": 0.06199272722005844,
      "pose_mae_dx": 0.015444603748619556,
      "pose_mae_dy": 0.026911329478025436,
      "pose_rmse_dtheta": 0.12580326199531555,
      "pose_rmse_dx": 0.03590703755617142,
      "pose_rmse_dy": 0.05845591053366661,
      "pose_rmse_mean": 0.07338874042034149,
      "rmse_dtheta": 0.018228979781270027,
      "rmse_dx": 0.004029254429042339,
      "rmse_dy": 0.0037928868550807238,
      "rmse_mean": 0.008683707565069199,
      "rotation_flip": 0.006067960988730192,
      "sparse_tokens": 32057.0,
      "step": 3672,
      "turn_loss": 0.07327251136302948,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22328.0,
      "epoch": 0.1706467199405315,
      "grad_norm": 0.5201884508132935,
      "learning_rate": 7.951747815401651e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.04129225015640259,
      "mae_dx": 0.01376681961119175,
      "mae_dy": 0.009865528903901577,
      "pose_mae_dtheta": 0.33577674627304077,
      "pose_mae_dx": 0.12285901606082916,
      "pose_mae_dy": 0.10909845679998398,
      "pose_rmse_dtheta": 0.5682723522186279,
      "pose_rmse_dx": 0.24962937831878662,
      "pose_rmse_dy": 0.22889186441898346,
      "pose_rmse_mean": 0.3489311933517456,
      "rmse_dtheta": 0.06072477996349335,
      "rmse_dx": 0.02620520628988743,
      "rmse_dy": 0.0167935062199831,
      "rmse_mean": 0.03457449749112129,
      "rotation_flip": 0.01149425283074379,
      "sparse_tokens": 18865.0,
      "step": 3673,
      "turn_loss": 0.3486902117729187,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 37316.0,
      "epoch": 0.1706931797063743,
      "grad_norm": 0.464595228433609,
      "learning_rate": 7.950680486088824e-06,
      "loss": 0.1288,
      "mae_dtheta": 0.03545132651925087,
      "mae_dx": 0.00919292401522398,
      "mae_dy": 0.0040632677264511585,
      "pose_mae_dtheta": 0.281795859336853,
      "pose_mae_dx": 0.07049201428890228,
      "pose_mae_dy": 0.04689032956957817,
      "pose_rmse_dtheta": 0.5197694301605225,
      "pose_rmse_dx": 0.1486903429031372,
      "pose_rmse_dy": 0.11889255791902542,
      "pose_rmse_mean": 0.26245078444480896,
      "rmse_dtheta": 0.056125640869140625,
      "rmse_dx": 0.019372940063476562,
      "rmse_dy": 0.00852653756737709,
      "rmse_mean": 0.028008371591567993,
      "rotation_flip": 0.01698513887822628,
      "sparse_tokens": 29816.0,
      "step": 3674,
      "turn_loss": 0.25150156021118164,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 27817.0,
      "epoch": 0.17073963947221707,
      "grad_norm": 0.4061611592769623,
      "learning_rate": 7.949612950433326e-06,
      "loss": 0.109,
      "mae_dtheta": 0.046675682067871094,
      "mae_dx": 0.012189828790724277,
      "mae_dy": 0.005014360882341862,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.40616124868392944,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 149.5216827392578,
      "model/head/act_norm_mean": 104.22775481468024,
      "model/head/act_norm_min": 70.59923553466797,
      "model/head/act_over_embed": 71.62628890426275,
      "model/head/grad_frac": 0.11207320541143417,
      "model/head/grad_norm": 0.045519791543483734,
      "model/head/grad_zero_frac": 0.00018116217688657343,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6807662609011628,
      "model/head/update_ratio": 0.0007832653936930001,
      "model/head/weight_delta": 7.141608238220215,
      "model/head/weight_delta_rel": 0.12528495490550995,
      "model/head/weight_norm": 58.115413665771484,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4170568287372589,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4170568287372589,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4170568287372589,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2866053572557921,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06342948973178864,
      "model/modality_embedder.encoders.pose/grad_norm": 0.02576260082423687,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0008348909323103726,
      "model/modality_embedder.encoders.pose/weight_delta": 2.340700149536133,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07647796720266342,
      "model/modality_embedder.encoders.pose/weight_norm": 30.857444763183594,
      "model/modality_embedder/grad_frac": 0.06342948973178864,
      "model/modality_embedder/grad_norm": 0.02576260082423687,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0008348909323103726,
      "model/modality_embedder/weight_delta": 2.340700149536133,
      "model/modality_embedder/weight_delta_rel": 0.07647796720266342,
      "model/modality_embedder/weight_norm": 30.857444763183594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.1639175415039,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.045676737264674,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.142457008361816,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.837204810873207,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09240496903657913,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03753131628036499,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013536211336031556,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.6417924165725708,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.059827905148267746,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.72660255432129,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.86608123779297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.87233527131783,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.690335273742676,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.405292294773666,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10016316175460815,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04068239405751228,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013847704976797104,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.0732243061065674,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07181811332702637,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.37843894958496,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 76.73045349121094,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.541790674603174,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.96965217590332,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.55255767759909,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10695847123861313,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.043442387133836746,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014324180083349347,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.2225847244262695,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07463023066520691,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.3280086517334,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.50201416015625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.530079134366925,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.640117645263672,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.918928121798576,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.13924381136894226,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05655543878674507,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019072535214945674,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.8972291946411133,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06483829021453857,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.652816772460938,
      "model/normalizer/grad_frac": 0.4836677610874176,
      "model/normalizer/grad_norm": 0.19644710421562195,
      "model/normalizer/grad_zero_frac": 0.00017017032951116562,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002511481288820505,
      "model/normalizer/weight_delta": 4.033874988555908,
      "model/normalizer/weight_delta_rel": 0.05195397511124611,
      "model/normalizer/weight_norm": 78.21961975097656,
      "pose_mae_dtheta": 0.3869484066963196,
      "pose_mae_dx": 0.085410475730896,
      "pose_mae_dy": 0.050741977989673615,
      "pose_rmse_dtheta": 0.6076695322990417,
      "pose_rmse_dx": 0.17960451543331146,
      "pose_rmse_dy": 0.13611064851284027,
      "pose_rmse_mean": 0.3077949285507202,
      "rmse_dtheta": 0.0645567998290062,
      "rmse_dx": 0.024434298276901245,
      "rmse_dy": 0.011519080027937889,
      "rmse_mean": 0.033503394573926926,
      "rotation_flip": 0.015053763054311275,
      "sparse_tokens": 22812.0,
      "step": 3675,
      "turn_loss": 0.37350091338157654,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.17078609923805985,
      "grad_norm": 0.6473808884620667,
      "learning_rate": 7.948545208509811e-06,
      "loss": 0.1767,
      "mae_dtheta": 0.013252719305455685,
      "mae_dx": 0.002840713830664754,
      "mae_dy": 0.0030354114715009928,
      "pose_mae_dtheta": 0.09354779869318008,
      "pose_mae_dx": 0.03390102833509445,
      "pose_mae_dy": 0.031905367970466614,
      "pose_rmse_dtheta": 0.24845096468925476,
      "pose_rmse_dx": 0.07997464388608932,
      "pose_rmse_dy": 0.07567781209945679,
      "pose_rmse_mean": 0.13470114767551422,
      "rmse_dtheta": 0.02885756641626358,
      "rmse_dx": 0.008060691878199577,
      "rmse_dy": 0.00685638003051281,
      "rmse_mean": 0.014591547660529613,
      "rotation_flip": 0.004909365437924862,
      "sparse_tokens": 32121.0,
      "step": 3676,
      "turn_loss": 0.0994652733206749,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.17083255900390262,
      "grad_norm": 0.5424692630767822,
      "learning_rate": 7.947477260392948e-06,
      "loss": 0.1076,
      "mae_dtheta": 0.029079729691147804,
      "mae_dx": 0.012035638093948364,
      "mae_dy": 0.004690699744969606,
      "pose_mae_dtheta": 0.26300710439682007,
      "pose_mae_dx": 0.09123885631561279,
      "pose_mae_dy": 0.05505241081118584,
      "pose_rmse_dtheta": 0.4516146779060364,
      "pose_rmse_dx": 0.1783289611339569,
      "pose_rmse_dy": 0.119349904358387,
      "pose_rmse_mean": 0.24976450204849243,
      "rmse_dtheta": 0.04584015905857086,
      "rmse_dx": 0.022879648953676224,
      "rmse_dy": 0.008236506953835487,
      "rmse_mean": 0.025652103126049042,
      "rotation_flip": 0.004587155766785145,
      "sparse_tokens": 3338.0,
      "step": 3677,
      "turn_loss": 0.30155640840530396,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.1708790187697454,
      "grad_norm": 0.8144063949584961,
      "learning_rate": 7.946409106157418e-06,
      "loss": 0.1667,
      "mae_dtheta": 0.03315345197916031,
      "mae_dx": 0.009328086860477924,
      "mae_dy": 0.008465388789772987,
      "pose_mae_dtheta": 0.2638411819934845,
      "pose_mae_dx": 0.08596783131361008,
      "pose_mae_dy": 0.11561684310436249,
      "pose_rmse_dtheta": 0.4440748989582062,
      "pose_rmse_dx": 0.17813542485237122,
      "pose_rmse_dy": 0.26986560225486755,
      "pose_rmse_mean": 0.2973586320877075,
      "rmse_dtheta": 0.05041336268186569,
      "rmse_dx": 0.020064720883965492,
      "rmse_dy": 0.01734689064323902,
      "rmse_mean": 0.029274990782141685,
      "rotation_flip": 0.020522387698292732,
      "sparse_tokens": 17665.0,
      "step": 3678,
      "turn_loss": 0.29810217022895813,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.17092547853558818,
      "grad_norm": 0.46267011761665344,
      "learning_rate": 7.945340745877919e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.009907261468470097,
      "mae_dx": 0.0021099995356053114,
      "mae_dy": 0.0021979568991810083,
      "pose_mae_dtheta": 0.06457586586475372,
      "pose_mae_dx": 0.02609274908900261,
      "pose_mae_dy": 0.027136141434311867,
      "pose_rmse_dtheta": 0.1319195032119751,
      "pose_rmse_dx": 0.05985467508435249,
      "pose_rmse_dy": 0.06097184121608734,
      "pose_rmse_mean": 0.08424867689609528,
      "rmse_dtheta": 0.019026722759008408,
      "rmse_dx": 0.006265601143240929,
      "rmse_dy": 0.004226090852171183,
      "rmse_mean": 0.00983947142958641,
      "rotation_flip": 0.0064282845705747604,
      "sparse_tokens": 32105.0,
      "step": 3679,
      "turn_loss": 0.09082535654306412,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34932.0,
      "epoch": 0.17097193830143095,
      "grad_norm": 0.7567111253738403,
      "learning_rate": 7.944272179629159e-06,
      "loss": 0.1967,
      "mae_dtheta": 0.03527896851301193,
      "mae_dx": 0.016873203217983246,
      "mae_dy": 0.004121618811041117,
      "pose_mae_dtheta": 0.2916003465652466,
      "pose_mae_dx": 0.1311766803264618,
      "pose_mae_dy": 0.06310509145259857,
      "pose_rmse_dtheta": 0.5173693895339966,
      "pose_rmse_dx": 0.2931188941001892,
      "pose_rmse_dy": 0.17848725616931915,
      "pose_rmse_mean": 0.32965850830078125,
      "rmse_dtheta": 0.053185973316431046,
      "rmse_dx": 0.031226012855768204,
      "rmse_dy": 0.008467872627079487,
      "rmse_mean": 0.030959954485297203,
      "rotation_flip": 0.005826657172292471,
      "sparse_tokens": 24710.0,
      "step": 3680,
      "turn_loss": 0.29976221919059753,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 20453.0,
      "epoch": 0.17101839806727373,
      "grad_norm": 0.4932113289833069,
      "learning_rate": 7.943203407485864e-06,
      "loss": 0.1101,
      "mae_dtheta": 0.03445928916335106,
      "mae_dx": 0.008497020229697227,
      "mae_dy": 0.0048338789492845535,
      "pose_mae_dtheta": 0.24274200201034546,
      "pose_mae_dx": 0.06411082297563553,
      "pose_mae_dy": 0.05016927048563957,
      "pose_rmse_dtheta": 0.44601526856422424,
      "pose_rmse_dx": 0.15030673146247864,
      "pose_rmse_dy": 0.12111160159111023,
      "pose_rmse_mean": 0.23914453387260437,
      "rmse_dtheta": 0.05366326496005058,
      "rmse_dx": 0.018892673775553703,
      "rmse_dy": 0.010183890350162983,
      "rmse_mean": 0.02757994458079338,
      "rotation_flip": 0.015350877307355404,
      "sparse_tokens": 14634.0,
      "step": 3681,
      "turn_loss": 0.2568649649620056,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.17106485783311653,
      "grad_norm": 0.5808682441711426,
      "learning_rate": 7.942134429522779e-06,
      "loss": 0.1496,
      "mae_dtheta": 0.0263853557407856,
      "mae_dx": 0.008486125618219376,
      "mae_dy": 0.002572699449956417,
      "pose_mae_dtheta": 0.18898507952690125,
      "pose_mae_dx": 0.056472569704055786,
      "pose_mae_dy": 0.026659416034817696,
      "pose_rmse_dtheta": 0.34535765647888184,
      "pose_rmse_dx": 0.1448371559381485,
      "pose_rmse_dy": 0.06537457555532455,
      "pose_rmse_mean": 0.18518978357315063,
      "rmse_dtheta": 0.04359711334109306,
      "rmse_dx": 0.018976163119077682,
      "rmse_dy": 0.006069303024560213,
      "rmse_mean": 0.022880859673023224,
      "rotation_flip": 0.009569377638399601,
      "sparse_tokens": 14124.0,
      "step": 3682,
      "turn_loss": 0.22442106902599335,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 23618.0,
      "epoch": 0.1711113175989593,
      "grad_norm": 1.1383167505264282,
      "learning_rate": 7.94106524581465e-06,
      "loss": 0.2585,
      "mae_dtheta": 0.033078573644161224,
      "mae_dx": 0.016824111342430115,
      "mae_dy": 0.005016387440264225,
      "pose_mae_dtheta": 0.2613040506839752,
      "pose_mae_dx": 0.1313275545835495,
      "pose_mae_dy": 0.09114037454128265,
      "pose_rmse_dtheta": 0.4534318447113037,
      "pose_rmse_dx": 0.28506532311439514,
      "pose_rmse_dy": 0.19507037103176117,
      "pose_rmse_mean": 0.3111891746520996,
      "rmse_dtheta": 0.05050814896821976,
      "rmse_dx": 0.03175478056073189,
      "rmse_dy": 0.008981680497527122,
      "rmse_mean": 0.030414871871471405,
      "rotation_flip": 0.012429378926753998,
      "sparse_tokens": 17452.0,
      "step": 3683,
      "turn_loss": 0.2496807724237442,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.1711577773648021,
      "grad_norm": 0.5024318695068359,
      "learning_rate": 7.939995856436253e-06,
      "loss": 0.089,
      "mae_dtheta": 0.007921917364001274,
      "mae_dx": 0.0018432928482070565,
      "mae_dy": 0.00021493494568858296,
      "pose_mae_dtheta": 0.05574167147278786,
      "pose_mae_dx": 0.016321523115038872,
      "pose_mae_dy": 0.002995182992890477,
      "pose_rmse_dtheta": 0.22899651527404785,
      "pose_rmse_dx": 0.03642141446471214,
      "pose_rmse_dy": 0.005567603744566441,
      "pose_rmse_mean": 0.09032851457595825,
      "rmse_dtheta": 0.028537124395370483,
      "rmse_dx": 0.004738848656415939,
      "rmse_dy": 0.00034624061663635075,
      "rmse_mean": 0.011207404546439648,
      "rotation_flip": 0.0015298316720873117,
      "sparse_tokens": 32265.0,
      "step": 3684,
      "turn_loss": 0.06106899678707123,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.17120423713064487,
      "grad_norm": 0.7084235548973083,
      "learning_rate": 7.938926261462366e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.023736361414194107,
      "mae_dx": 0.012346659786999226,
      "mae_dy": 0.004910153802484274,
      "pose_mae_dtheta": 0.18422359228134155,
      "pose_mae_dx": 0.09396583586931229,
      "pose_mae_dy": 0.09446822851896286,
      "pose_rmse_dtheta": 0.2893124222755432,
      "pose_rmse_dx": 0.20030935108661652,
      "pose_rmse_dy": 0.20471177995204926,
      "pose_rmse_mean": 0.23144452273845673,
      "rmse_dtheta": 0.036268770694732666,
      "rmse_dx": 0.026141269132494926,
      "rmse_dy": 0.008852751925587654,
      "rmse_mean": 0.023754265159368515,
      "rotation_flip": 0.00817438680678606,
      "sparse_tokens": 6273.0,
      "step": 3685,
      "turn_loss": 0.17460906505584717,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.17125069689648764,
      "grad_norm": 0.45371517539024353,
      "learning_rate": 7.93785646096779e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.011629907414317131,
      "mae_dx": 0.00168574508279562,
      "mae_dy": 0.0022566881962120533,
      "pose_mae_dtheta": 0.08096624910831451,
      "pose_mae_dx": 0.020367253571748734,
      "pose_mae_dy": 0.030093815177679062,
      "pose_rmse_dtheta": 0.18608644604682922,
      "pose_rmse_dx": 0.04832311347126961,
      "pose_rmse_dy": 0.07567813247442245,
      "pose_rmse_mean": 0.1033625602722168,
      "rmse_dtheta": 0.02474789135158062,
      "rmse_dx": 0.00498203095048666,
      "rmse_dy": 0.005092172883450985,
      "rmse_mean": 0.011607365682721138,
      "rotation_flip": 0.0030146425124257803,
      "sparse_tokens": 32073.0,
      "step": 3686,
      "turn_loss": 0.1026659682393074,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.17129715666233042,
      "grad_norm": 0.6901442408561707,
      "learning_rate": 7.936786455027333e-06,
      "loss": 0.1456,
      "mae_dtheta": 0.033704470843076706,
      "mae_dx": 0.013973184861242771,
      "mae_dy": 0.004612891469150782,
      "pose_mae_dtheta": 0.26111721992492676,
      "pose_mae_dx": 0.12402790039777756,
      "pose_mae_dy": 0.07005644589662552,
      "pose_rmse_dtheta": 0.44049569964408875,
      "pose_rmse_dx": 0.2639228403568268,
      "pose_rmse_dy": 0.14402362704277039,
      "pose_rmse_mean": 0.282814085483551,
      "rmse_dtheta": 0.04964161291718483,
      "rmse_dx": 0.027884026989340782,
      "rmse_dy": 0.00794142670929432,
      "rmse_mean": 0.028489021584391594,
      "rotation_flip": 0.01068804319947958,
      "sparse_tokens": 27464.0,
      "step": 3687,
      "turn_loss": 0.26434579491615295,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.1713436164281732,
      "grad_norm": 0.5913851261138916,
      "learning_rate": 7.935716243715822e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.008597340434789658,
      "mae_dx": 0.00206725369207561,
      "mae_dy": 0.00025678734527900815,
      "pose_mae_dtheta": 0.06256905198097229,
      "pose_mae_dx": 0.017318647354841232,
      "pose_mae_dy": 0.004460772033780813,
      "pose_rmse_dtheta": 0.24224254488945007,
      "pose_rmse_dx": 0.039335545152425766,
      "pose_rmse_dy": 0.010064210742712021,
      "pose_rmse_mean": 0.09721410274505615,
      "rmse_dtheta": 0.028881147503852844,
      "rmse_dx": 0.005470701493322849,
      "rmse_dy": 0.000437817390775308,
      "rmse_mean": 0.011596555821597576,
      "rotation_flip": 0.0022935778833925724,
      "sparse_tokens": 32249.0,
      "step": 3688,
      "turn_loss": 0.049084119498729706,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.17139007619401597,
      "grad_norm": 0.44430938363075256,
      "learning_rate": 7.934645827108101e-06,
      "loss": 0.0948,
      "mae_dtheta": 0.013106177560985088,
      "mae_dx": 0.0033560623414814472,
      "mae_dy": 0.003386426018550992,
      "pose_mae_dtheta": 0.08480135351419449,
      "pose_mae_dx": 0.03506578505039215,
      "pose_mae_dy": 0.031241871416568756,
      "pose_rmse_dtheta": 0.17788857221603394,
      "pose_rmse_dx": 0.07903481274843216,
      "pose_rmse_dy": 0.06967619806528091,
      "pose_rmse_mean": 0.10886652767658234,
      "rmse_dtheta": 0.025591325014829636,
      "rmse_dx": 0.008157911710441113,
      "rmse_dy": 0.0070091295056045055,
      "rmse_mean": 0.013586122542619705,
      "rotation_flip": 0.005484460853040218,
      "sparse_tokens": 32153.0,
      "step": 3689,
      "turn_loss": 0.12071345746517181,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.17143653595985875,
      "grad_norm": 0.7524212002754211,
      "learning_rate": 7.93357520527902e-06,
      "loss": 0.1725,
      "mae_dtheta": 0.013601068407297134,
      "mae_dx": 0.0027494989335536957,
      "mae_dy": 0.004409448709338903,
      "pose_mae_dtheta": 0.09699005633592606,
      "pose_mae_dx": 0.0406007282435894,
      "pose_mae_dy": 0.0512448288500309,
      "pose_rmse_dtheta": 0.20247891545295715,
      "pose_rmse_dx": 0.10491897910833359,
      "pose_rmse_dy": 0.11912773549556732,
      "pose_rmse_mean": 0.14217522740364075,
      "rmse_dtheta": 0.02604077011346817,
      "rmse_dx": 0.00875056441873312,
      "rmse_dy": 0.00894894078373909,
      "rmse_mean": 0.014580092392861843,
      "rotation_flip": 0.008916324004530907,
      "sparse_tokens": 32057.0,
      "step": 3690,
      "turn_loss": 0.11245178431272507,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.17148299572570155,
      "grad_norm": 0.5758250951766968,
      "learning_rate": 7.932504378303452e-06,
      "loss": 0.1564,
      "mae_dtheta": 0.030609633773565292,
      "mae_dx": 0.007031887769699097,
      "mae_dy": 0.004123367834836245,
      "pose_mae_dtheta": 0.20516344904899597,
      "pose_mae_dx": 0.04845556989312172,
      "pose_mae_dy": 0.05545448884367943,
      "pose_rmse_dtheta": 0.3853713870048523,
      "pose_rmse_dx": 0.10318419337272644,
      "pose_rmse_dy": 0.13027068972587585,
      "pose_rmse_mean": 0.20627543330192566,
      "rmse_dtheta": 0.049312710762023926,
      "rmse_dx": 0.016476910561323166,
      "rmse_dy": 0.008240537717938423,
      "rmse_mean": 0.024676721543073654,
      "rotation_flip": 0.017061611637473106,
      "sparse_tokens": 16888.0,
      "step": 3691,
      "turn_loss": 0.2137325406074524,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.17152945549154433,
      "grad_norm": 0.5136525630950928,
      "learning_rate": 7.931433346256278e-06,
      "loss": 0.0824,
      "mae_dtheta": 0.008164830505847931,
      "mae_dx": 0.0018886389443650842,
      "mae_dy": 0.0016491179121658206,
      "pose_mae_dtheta": 0.05249684676527977,
      "pose_mae_dx": 0.018717942759394646,
      "pose_mae_dy": 0.019225547090172768,
      "pose_rmse_dtheta": 0.14588095247745514,
      "pose_rmse_dx": 0.045954495668411255,
      "pose_rmse_dy": 0.04827970638871193,
      "pose_rmse_mean": 0.08003838360309601,
      "rmse_dtheta": 0.02050946094095707,
      "rmse_dx": 0.005726408679038286,
      "rmse_dy": 0.003895809641107917,
      "rmse_mean": 0.01004389300942421,
      "rotation_flip": 0.003588087623938918,
      "sparse_tokens": 32217.0,
      "step": 3692,
      "turn_loss": 0.06765959411859512,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.1715759152573871,
      "grad_norm": 0.5921033024787903,
      "learning_rate": 7.930362109212397e-06,
      "loss": 0.1333,
      "mae_dtheta": 0.01665499247610569,
      "mae_dx": 0.004812637809664011,
      "mae_dy": 0.004438166972249746,
      "pose_mae_dtheta": 0.13307490944862366,
      "pose_mae_dx": 0.042115677148103714,
      "pose_mae_dy": 0.03907150775194168,
      "pose_rmse_dtheta": 0.3429654836654663,
      "pose_rmse_dx": 0.13077370822429657,
      "pose_rmse_dy": 0.1133694052696228,
      "pose_rmse_mean": 0.19570288062095642,
      "rmse_dtheta": 0.03840405493974686,
      "rmse_dx": 0.012444081716239452,
      "rmse_dy": 0.012465943582355976,
      "rmse_mean": 0.02110469341278076,
      "rotation_flip": 0.0072930073365569115,
      "sparse_tokens": 32201.0,
      "step": 3693,
      "turn_loss": 0.16920706629753113,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.17162237502322988,
      "grad_norm": 0.6777052283287048,
      "learning_rate": 7.929290667246721e-06,
      "loss": 0.1413,
      "mae_dtheta": 0.030459554865956306,
      "mae_dx": 0.013624892570078373,
      "mae_dy": 0.0054143755696713924,
      "pose_mae_dtheta": 0.23113174736499786,
      "pose_mae_dx": 0.128168523311615,
      "pose_mae_dy": 0.09133238345384598,
      "pose_rmse_dtheta": 0.42227354645729065,
      "pose_rmse_dx": 0.2613593637943268,
      "pose_rmse_dy": 0.19587095081806183,
      "pose_rmse_mean": 0.29316794872283936,
      "rmse_dtheta": 0.04594797268509865,
      "rmse_dx": 0.026856690645217896,
      "rmse_dy": 0.009305326268076897,
      "rmse_mean": 0.027369996532797813,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 12351.0,
      "step": 3694,
      "turn_loss": 0.23918022215366364,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.17166883478907266,
      "grad_norm": 0.36053457856178284,
      "learning_rate": 7.928219020434175e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.04812128096818924,
      "mae_dx": 0.013168947771191597,
      "mae_dy": 0.008572396822273731,
      "pose_mae_dtheta": 0.34984323382377625,
      "pose_mae_dx": 0.10181311517953873,
      "pose_mae_dy": 0.09595937281847,
      "pose_rmse_dtheta": 0.5937045216560364,
      "pose_rmse_dx": 0.244938924908638,
      "pose_rmse_dy": 0.18239176273345947,
      "pose_rmse_mean": 0.3403450846672058,
      "rmse_dtheta": 0.06548836082220078,
      "rmse_dx": 0.02661973424255848,
      "rmse_dy": 0.014159935526549816,
      "rmse_mean": 0.0354226753115654,
      "rotation_flip": 0.009287925437092781,
      "sparse_tokens": 10999.0,
      "step": 3695,
      "turn_loss": 0.5096513032913208,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.17171529455491544,
      "grad_norm": 0.416385293006897,
      "learning_rate": 7.927147168849704e-06,
      "loss": 0.1134,
      "mae_dtheta": 0.029535410925745964,
      "mae_dx": 0.012000059708952904,
      "mae_dy": 0.0060507506132125854,
      "pose_mae_dtheta": 0.22540563344955444,
      "pose_mae_dx": 0.09994979947805405,
      "pose_mae_dy": 0.056044768542051315,
      "pose_rmse_dtheta": 0.39773285388946533,
      "pose_rmse_dx": 0.2339297980070114,
      "pose_rmse_dy": 0.13271892070770264,
      "pose_rmse_mean": 0.2547938823699951,
      "rmse_dtheta": 0.046707939356565475,
      "rmse_dx": 0.023842910304665565,
      "rmse_dy": 0.013788528740406036,
      "rmse_mean": 0.028113126754760742,
      "rotation_flip": 0.015952980145812035,
      "sparse_tokens": 21396.0,
      "step": 3696,
      "turn_loss": 0.28925958275794983,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.17176175432075821,
      "grad_norm": 0.536892294883728,
      "learning_rate": 7.92607511256826e-06,
      "loss": 0.1831,
      "mae_dtheta": 0.02608737349510193,
      "mae_dx": 0.010081726126372814,
      "mae_dy": 0.004126441664993763,
      "pose_mae_dtheta": 0.20476777851581573,
      "pose_mae_dx": 0.0948498398065567,
      "pose_mae_dy": 0.0581304207444191,
      "pose_rmse_dtheta": 0.3430465757846832,
      "pose_rmse_dx": 0.20402628183364868,
      "pose_rmse_dy": 0.1232919692993164,
      "pose_rmse_mean": 0.22345495223999023,
      "rmse_dtheta": 0.04080317169427872,
      "rmse_dx": 0.02189464122056961,
      "rmse_dy": 0.007567045744508505,
      "rmse_mean": 0.023421620950102806,
      "rotation_flip": 0.014625228941440582,
      "sparse_tokens": 20602.0,
      "step": 3697,
      "turn_loss": 0.24726499617099762,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 1980.0,
      "epoch": 0.171808214086601,
      "grad_norm": 0.6090637445449829,
      "learning_rate": 7.92500285166481e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.023428594693541527,
      "mae_dx": 0.004497102461755276,
      "mae_dy": 0.0024784309789538383,
      "pose_mae_dtheta": 0.1574074625968933,
      "pose_mae_dx": 0.031535178422927856,
      "pose_mae_dy": 0.04563046619296074,
      "pose_rmse_dtheta": 0.34248843789100647,
      "pose_rmse_dx": 0.05732034146785736,
      "pose_rmse_dy": 0.1109687089920044,
      "pose_rmse_mean": 0.17025916278362274,
      "rmse_dtheta": 0.048731479793787,
      "rmse_dx": 0.00797253381460905,
      "rmse_dy": 0.004378965124487877,
      "rmse_mean": 0.020360995084047318,
      "rotation_flip": 0.0,
      "sparse_tokens": 1700.0,
      "step": 3698,
      "turn_loss": 0.12106891721487045,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.1718546738524438,
      "grad_norm": 0.45078492164611816,
      "learning_rate": 7.923930386214343e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.030359242111444473,
      "mae_dx": 0.009229863993823528,
      "mae_dy": 0.0048628090880811214,
      "pose_mae_dtheta": 0.22363491356372833,
      "pose_mae_dx": 0.07928451150655746,
      "pose_mae_dy": 0.06084214523434639,
      "pose_rmse_dtheta": 0.40848636627197266,
      "pose_rmse_dx": 0.20157510042190552,
      "pose_rmse_dy": 0.12942737340927124,
      "pose_rmse_mean": 0.2464962899684906,
      "rmse_dtheta": 0.04887261986732483,
      "rmse_dx": 0.022119494155049324,
      "rmse_dy": 0.010393104515969753,
      "rmse_mean": 0.02712840586900711,
      "rotation_flip": 0.008154943585395813,
      "sparse_tokens": 18527.0,
      "step": 3699,
      "turn_loss": 0.23212666809558868,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.17190113361828657,
      "grad_norm": 0.8079405426979065,
      "learning_rate": 7.922857716291852e-06,
      "loss": 0.34,
      "mae_dtheta": 0.0539047047495842,
      "mae_dx": 0.015363787300884724,
      "mae_dy": 0.007243626285344362,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8079406023025513,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 146.41561889648438,
      "model/head/act_norm_mean": 105.80747767857143,
      "model/head/act_norm_min": 75.40283966064453,
      "model/head/act_over_embed": 72.71188924592724,
      "model/head/grad_frac": 0.1128738522529602,
      "model/head/grad_norm": 0.09119536727666855,
      "model/head/grad_zero_frac": 0.00020939936803188175,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6883370535714286,
      "model/head/update_ratio": 0.0015690737636759877,
      "model/head/weight_delta": 7.1652398109436035,
      "model/head/weight_delta_rel": 0.12569953501224518,
      "model/head/weight_norm": 58.12051010131836,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41695570945739746,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41695570945739746,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41695570945739746,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2865358671399777,
      "model/modality_embedder.encoders.pose/grad_frac": 0.03839068114757538,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03101738914847374,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010051270946860313,
      "model/modality_embedder.encoders.pose/weight_delta": 2.3519535064697266,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07684565335512161,
      "model/modality_embedder.encoders.pose/weight_norm": 30.859172821044922,
      "model/modality_embedder/grad_frac": 0.03839068114757538,
      "model/modality_embedder/grad_norm": 0.03101738914847374,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0010051270946860313,
      "model/modality_embedder/weight_delta": 2.3519535064697266,
      "model/modality_embedder/weight_delta_rel": 0.07684565335512161,
      "model/modality_embedder/weight_norm": 30.859172821044922,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.75025939941406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.247698963844798,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.182027816772461,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.97603637634095,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11246230453252792,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.09086286276578903,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0032768617384135723,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.6498759984970093,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06012247875332832,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.728622436523438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.45963287353516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.09398226883346,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.679913520812988,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.55761018655829,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.12281519919633865,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.09922738373279572,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0033771402668207884,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.0837650299072266,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07218325138092041,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.3820743560791,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 73.98200225830078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.696672650541696,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.452122688293457,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.658994021491946,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.12824851274490356,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.10361717641353607,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0034162462688982487,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.2341010570526123,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07501693069934845,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.33070945739746,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.31285858154297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.652736441798943,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.242647171020508,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.003219371801663,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.14086100459098816,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.1138073205947876,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0038377351593226194,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.9063509702682495,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06515002995729446,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.654813766479492,
      "model/normalizer/grad_frac": 0.5292143821716309,
      "model/normalizer/grad_norm": 0.4275738000869751,
      "model/normalizer/grad_zero_frac": 0.00018671466386877,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.005466096103191376,
      "model/normalizer/weight_delta": 4.054217338562012,
      "model/normalizer/weight_delta_rel": 0.05221597105264664,
      "model/normalizer/weight_norm": 78.22288513183594,
      "pose_mae_dtheta": 0.47041797637939453,
      "pose_mae_dx": 0.11282408982515335,
      "pose_mae_dy": 0.07387802004814148,
      "pose_rmse_dtheta": 0.7232545018196106,
      "pose_rmse_dx": 0.22303196787834167,
      "pose_rmse_dy": 0.21443486213684082,
      "pose_rmse_mean": 0.38690710067749023,
      "rmse_dtheta": 0.07108020782470703,
      "rmse_dx": 0.02699684165418148,
      "rmse_dy": 0.01691013015806675,
      "rmse_mean": 0.03832906112074852,
      "rotation_flip": 0.009940357878804207,
      "sparse_tokens": 14904.0,
      "step": 3700,
      "turn_loss": 0.4031936526298523,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.17194759338412935,
      "grad_norm": 0.4990507662296295,
      "learning_rate": 7.921784841972355e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.011769812554121017,
      "mae_dx": 0.0025625131092965603,
      "mae_dy": 0.0028623437974601984,
      "pose_mae_dtheta": 0.0779772624373436,
      "pose_mae_dx": 0.02973690629005432,
      "pose_mae_dy": 0.03361163288354874,
      "pose_rmse_dtheta": 0.17080093920230865,
      "pose_rmse_dx": 0.07812413573265076,
      "pose_rmse_dy": 0.07949738949537277,
      "pose_rmse_mean": 0.10947415232658386,
      "rmse_dtheta": 0.024584757164120674,
      "rmse_dx": 0.006753851193934679,
      "rmse_dy": 0.006973844021558762,
      "rmse_mean": 0.012770818546414375,
      "rotation_flip": 0.005531410686671734,
      "sparse_tokens": 32121.0,
      "step": 3701,
      "turn_loss": 0.1143883466720581,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.17199405314997213,
      "grad_norm": 0.569412350654602,
      "learning_rate": 7.920711763330875e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.01031197514384985,
      "mae_dx": 0.0018041515722870827,
      "mae_dy": 0.002152541419491172,
      "pose_mae_dtheta": 0.07315319776535034,
      "pose_mae_dx": 0.021011730656027794,
      "pose_mae_dy": 0.02565573714673519,
      "pose_rmse_dtheta": 0.19426976144313812,
      "pose_rmse_dx": 0.0510605126619339,
      "pose_rmse_dy": 0.0668545663356781,
      "pose_rmse_mean": 0.10406161844730377,
      "rmse_dtheta": 0.025399290025234222,
      "rmse_dx": 0.00485897995531559,
      "rmse_dy": 0.005053090397268534,
      "rmse_mean": 0.011770453304052353,
      "rotation_flip": 0.004129128996282816,
      "sparse_tokens": 32201.0,
      "step": 3702,
      "turn_loss": 0.06996653974056244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1720405129158149,
      "grad_norm": 0.4185324013233185,
      "learning_rate": 7.919638480442453e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.010580124333500862,
      "mae_dx": 0.0015618627658113837,
      "mae_dy": 0.002002222230657935,
      "pose_mae_dtheta": 0.07580099999904633,
      "pose_mae_dx": 0.018459223210811615,
      "pose_mae_dy": 0.023546013981103897,
      "pose_rmse_dtheta": 0.23121196031570435,
      "pose_rmse_dx": 0.049353957176208496,
      "pose_rmse_dy": 0.05463666468858719,
      "pose_rmse_mean": 0.11173419654369354,
      "rmse_dtheta": 0.026386968791484833,
      "rmse_dx": 0.004959713667631149,
      "rmse_dy": 0.004520713817328215,
      "rmse_mean": 0.011955799534916878,
      "rotation_flip": 0.001308900536969304,
      "sparse_tokens": 32105.0,
      "step": 3703,
      "turn_loss": 0.0778188481926918,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.17208697268165768,
      "grad_norm": 0.3275328576564789,
      "learning_rate": 7.918564993382147e-06,
      "loss": 0.0925,
      "mae_dtheta": 0.028251826763153076,
      "mae_dx": 0.005230150651186705,
      "mae_dy": 0.005419800523668528,
      "pose_mae_dtheta": 0.18078814446926117,
      "pose_mae_dx": 0.047575704753398895,
      "pose_mae_dy": 0.057814616709947586,
      "pose_rmse_dtheta": 0.3146238327026367,
      "pose_rmse_dx": 0.1459142416715622,
      "pose_rmse_dy": 0.1119033619761467,
      "pose_rmse_mean": 0.1908138245344162,
      "rmse_dtheta": 0.0432606041431427,
      "rmse_dx": 0.014237083494663239,
      "rmse_dy": 0.00984372477978468,
      "rmse_mean": 0.022447137162089348,
      "rotation_flip": 0.017307693138718605,
      "sparse_tokens": 18831.0,
      "step": 3704,
      "turn_loss": 0.21793407201766968,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.17213343244750046,
      "grad_norm": 0.7582159042358398,
      "learning_rate": 7.917491302225022e-06,
      "loss": 0.1612,
      "mae_dtheta": 0.005045656580477953,
      "mae_dx": 0.0013641859404742718,
      "mae_dy": 0.0006947763613425195,
      "pose_mae_dtheta": 0.03686252981424332,
      "pose_mae_dx": 0.012817759066820145,
      "pose_mae_dy": 0.010067900642752647,
      "pose_rmse_dtheta": 0.13481467962265015,
      "pose_rmse_dx": 0.03958827629685402,
      "pose_rmse_dy": 0.034375984221696854,
      "pose_rmse_mean": 0.06959298253059387,
      "rmse_dtheta": 0.017900872975587845,
      "rmse_dx": 0.0045977686531841755,
      "rmse_dy": 0.001947066280990839,
      "rmse_mean": 0.008148569613695145,
      "rotation_flip": 0.0006215040339156985,
      "sparse_tokens": 32137.0,
      "step": 3705,
      "turn_loss": 0.04275694862008095,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.17217989221334323,
      "grad_norm": 0.4920697510242462,
      "learning_rate": 7.916417407046166e-06,
      "loss": 0.0789,
      "mae_dtheta": 0.041287656873464584,
      "mae_dx": 0.01652926579117775,
      "mae_dy": 0.006143171805888414,
      "pose_mae_dtheta": 0.3655293583869934,
      "pose_mae_dx": 0.12774881720542908,
      "pose_mae_dy": 0.11206794530153275,
      "pose_rmse_dtheta": 0.561366617679596,
      "pose_rmse_dx": 0.27408531308174133,
      "pose_rmse_dy": 0.22355934977531433,
      "pose_rmse_mean": 0.3530037999153137,
      "rmse_dtheta": 0.05972601845860481,
      "rmse_dx": 0.03091924451291561,
      "rmse_dy": 0.010632297955453396,
      "rmse_mean": 0.033759187906980515,
      "rotation_flip": 0.020348837599158287,
      "sparse_tokens": 5109.0,
      "step": 3706,
      "turn_loss": 0.34268897771835327,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.17222635197918604,
      "grad_norm": 0.5102866888046265,
      "learning_rate": 7.915343307920674e-06,
      "loss": 0.1805,
      "mae_dtheta": 0.03272204101085663,
      "mae_dx": 0.009590444155037403,
      "mae_dy": 0.006482597906142473,
      "pose_mae_dtheta": 0.24750369787216187,
      "pose_mae_dx": 0.07094498723745346,
      "pose_mae_dy": 0.06826911121606827,
      "pose_rmse_dtheta": 0.40428876876831055,
      "pose_rmse_dx": 0.16290955245494843,
      "pose_rmse_dy": 0.16392774879932404,
      "pose_rmse_mean": 0.24370869994163513,
      "rmse_dtheta": 0.05046892538666725,
      "rmse_dx": 0.02032529003918171,
      "rmse_dy": 0.015204908326268196,
      "rmse_mean": 0.02866637520492077,
      "rotation_flip": 0.014662756584584713,
      "sparse_tokens": 18342.0,
      "step": 3707,
      "turn_loss": 0.2978661060333252,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 39263.0,
      "epoch": 0.17227281174502881,
      "grad_norm": 0.7585800886154175,
      "learning_rate": 7.91426900492366e-06,
      "loss": 0.1609,
      "mae_dtheta": 0.04278286546468735,
      "mae_dx": 0.012613126076757908,
      "mae_dy": 0.006493909750133753,
      "pose_mae_dtheta": 0.35408052802085876,
      "pose_mae_dx": 0.11419368535280228,
      "pose_mae_dy": 0.06288659572601318,
      "pose_rmse_dtheta": 0.5888869762420654,
      "pose_rmse_dx": 0.2370925098657608,
      "pose_rmse_dy": 0.16393278539180756,
      "pose_rmse_mean": 0.3299707770347595,
      "rmse_dtheta": 0.06149226427078247,
      "rmse_dx": 0.024030886590480804,
      "rmse_dy": 0.014398430474102497,
      "rmse_mean": 0.03330719470977783,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 29963.0,
      "step": 3708,
      "turn_loss": 0.3776175081729889,
      "turns": 121.0,
      "turns_per_sample": 121.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1723192715108716,
      "grad_norm": 0.40543845295906067,
      "learning_rate": 7.913194498130252e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.00786594022065401,
      "mae_dx": 0.0013796408893540502,
      "mae_dy": 0.0019210295286029577,
      "pose_mae_dtheta": 0.05166323855519295,
      "pose_mae_dx": 0.02036350592970848,
      "pose_mae_dy": 0.024294640868902206,
      "pose_rmse_dtheta": 0.13750222325325012,
      "pose_rmse_dx": 0.0547139011323452,
      "pose_rmse_dy": 0.06256017833948135,
      "pose_rmse_mean": 0.08492543548345566,
      "rmse_dtheta": 0.018726905807852745,
      "rmse_dx": 0.0038544952403753996,
      "rmse_dy": 0.00451193330809474,
      "rmse_mean": 0.009031111374497414,
      "rotation_flip": 0.0013525699032470584,
      "sparse_tokens": 32105.0,
      "step": 3709,
      "turn_loss": 0.06659000366926193,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.17236573127671437,
      "grad_norm": 0.3895759582519531,
      "learning_rate": 7.912119787615587e-06,
      "loss": 0.0817,
      "mae_dtheta": 0.011996607296168804,
      "mae_dx": 0.0018168932292610407,
      "mae_dy": 0.0025374689139425755,
      "pose_mae_dtheta": 0.08380123227834702,
      "pose_mae_dx": 0.023920556530356407,
      "pose_mae_dy": 0.033478960394859314,
      "pose_rmse_dtheta": 0.228285014629364,
      "pose_rmse_dx": 0.05531512573361397,
      "pose_rmse_dy": 0.07551383972167969,
      "pose_rmse_mean": 0.11970466375350952,
      "rmse_dtheta": 0.027166184037923813,
      "rmse_dx": 0.0049595641903579235,
      "rmse_dy": 0.005169964395463467,
      "rmse_mean": 0.012431904673576355,
      "rotation_flip": 0.0023847375996410847,
      "sparse_tokens": 32073.0,
      "step": 3710,
      "turn_loss": 0.09224995970726013,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17241219104255714,
      "grad_norm": 0.5872909426689148,
      "learning_rate": 7.911044873454823e-06,
      "loss": 0.1041,
      "mae_dtheta": 0.010994620621204376,
      "mae_dx": 0.0020652473904192448,
      "mae_dy": 0.002315595978870988,
      "pose_mae_dtheta": 0.0781407430768013,
      "pose_mae_dx": 0.02386782318353653,
      "pose_mae_dy": 0.02883370779454708,
      "pose_rmse_dtheta": 0.1887507140636444,
      "pose_rmse_dx": 0.06369484961032867,
      "pose_rmse_dy": 0.05847759172320366,
      "pose_rmse_mean": 0.10364105552434921,
      "rmse_dtheta": 0.022870080545544624,
      "rmse_dx": 0.006653932388871908,
      "rmse_dy": 0.00462693627923727,
      "rmse_mean": 0.011383650824427605,
      "rotation_flip": 0.007289879955351353,
      "sparse_tokens": 32089.0,
      "step": 3711,
      "turn_loss": 0.08483578264713287,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.17245865080839992,
      "grad_norm": 0.29685473442077637,
      "learning_rate": 7.90996975572313e-06,
      "loss": 0.0689,
      "mae_dtheta": 0.009240521118044853,
      "mae_dx": 0.0014682274777442217,
      "mae_dy": 0.0020695982966572046,
      "pose_mae_dtheta": 0.06357603520154953,
      "pose_mae_dx": 0.020101461559534073,
      "pose_mae_dy": 0.022897036746144295,
      "pose_rmse_dtheta": 0.15561237931251526,
      "pose_rmse_dx": 0.053962014615535736,
      "pose_rmse_dy": 0.053015515208244324,
      "pose_rmse_mean": 0.0875299796462059,
      "rmse_dtheta": 0.020816240459680557,
      "rmse_dx": 0.004033383447676897,
      "rmse_dy": 0.0048469905741512775,
      "rmse_mean": 0.009898871183395386,
      "rotation_flip": 0.002728512976318598,
      "sparse_tokens": 32073.0,
      "step": 3712,
      "turn_loss": 0.07435901463031769,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1725051105742427,
      "grad_norm": 0.8802297115325928,
      "learning_rate": 7.90889443449569e-06,
      "loss": 0.1635,
      "mae_dtheta": 0.015565956942737103,
      "mae_dx": 0.0032733732368797064,
      "mae_dy": 0.0037934021092951298,
      "pose_mae_dtheta": 0.10416802018880844,
      "pose_mae_dx": 0.030699707567691803,
      "pose_mae_dy": 0.04439215362071991,
      "pose_rmse_dtheta": 0.2560872435569763,
      "pose_rmse_dx": 0.08359886705875397,
      "pose_rmse_dy": 0.11991044133901596,
      "pose_rmse_mean": 0.15319885313510895,
      "rmse_dtheta": 0.03180396929383278,
      "rmse_dx": 0.010943270288407803,
      "rmse_dy": 0.010324835777282715,
      "rmse_mean": 0.017690692096948624,
      "rotation_flip": 0.005723006557673216,
      "sparse_tokens": 32105.0,
      "step": 3713,
      "turn_loss": 0.14046351611614227,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.17255157034008548,
      "grad_norm": 0.48970794677734375,
      "learning_rate": 7.907818909847698e-06,
      "loss": 0.1471,
      "mae_dtheta": 0.008478916250169277,
      "mae_dx": 0.0024876496754586697,
      "mae_dy": 0.002756281290203333,
      "pose_mae_dtheta": 0.06184392794966698,
      "pose_mae_dx": 0.030269188806414604,
      "pose_mae_dy": 0.020879706367850304,
      "pose_rmse_dtheta": 0.19623056054115295,
      "pose_rmse_dx": 0.08327077329158783,
      "pose_rmse_dy": 0.05042644590139389,
      "pose_rmse_mean": 0.10997592657804489,
      "rmse_dtheta": 0.02337993122637272,
      "rmse_dx": 0.006370376329869032,
      "rmse_dy": 0.006829737685620785,
      "rmse_mean": 0.01219334825873375,
      "rotation_flip": 0.0017467249417677522,
      "sparse_tokens": 32153.0,
      "step": 3714,
      "turn_loss": 0.0868004783987999,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.17259803010592828,
      "grad_norm": 0.49593988060951233,
      "learning_rate": 7.90674318185437e-06,
      "loss": 0.1449,
      "mae_dtheta": 0.009674334898591042,
      "mae_dx": 0.0011234884150326252,
      "mae_dy": 0.002151384949684143,
      "pose_mae_dtheta": 0.06365843862295151,
      "pose_mae_dx": 0.02016357146203518,
      "pose_mae_dy": 0.027341995388269424,
      "pose_rmse_dtheta": 0.14341387152671814,
      "pose_rmse_dx": 0.05423211306333542,
      "pose_rmse_dy": 0.063068687915802,
      "pose_rmse_mean": 0.08690489828586578,
      "rmse_dtheta": 0.020328251644968987,
      "rmse_dx": 0.0031214524060487747,
      "rmse_dy": 0.004511729348450899,
      "rmse_mean": 0.009320477955043316,
      "rotation_flip": 0.00477326987311244,
      "sparse_tokens": 32073.0,
      "step": 3715,
      "turn_loss": 0.06478436291217804,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.17264448987177106,
      "grad_norm": 0.39538392424583435,
      "learning_rate": 7.905667250590932e-06,
      "loss": 0.1076,
      "mae_dtheta": 0.011439469642937183,
      "mae_dx": 0.0020034981425851583,
      "mae_dy": 0.0029936672654002905,
      "pose_mae_dtheta": 0.07727083563804626,
      "pose_mae_dx": 0.027141526341438293,
      "pose_mae_dy": 0.035056743770837784,
      "pose_rmse_dtheta": 0.16021104156970978,
      "pose_rmse_dx": 0.06538940966129303,
      "pose_rmse_dy": 0.07939422875642776,
      "pose_rmse_mean": 0.10166489332914352,
      "rmse_dtheta": 0.022077124565839767,
      "rmse_dx": 0.0064539359882473946,
      "rmse_dy": 0.006700227968394756,
      "rmse_mean": 0.011743763461709023,
      "rotation_flip": 0.004954268224537373,
      "sparse_tokens": 32073.0,
      "step": 3716,
      "turn_loss": 0.10608958452939987,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5207.0,
      "epoch": 0.17269094963761383,
      "grad_norm": 0.6083665490150452,
      "learning_rate": 7.904591116132624e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.0419745147228241,
      "mae_dx": 0.01844116859138012,
      "mae_dy": 0.02084805630147457,
      "pose_mae_dtheta": 0.34918078780174255,
      "pose_mae_dx": 0.2263435423374176,
      "pose_mae_dy": 0.23319916427135468,
      "pose_rmse_dtheta": 0.6420941352844238,
      "pose_rmse_dx": 0.4055739939212799,
      "pose_rmse_dy": 0.4520023465156555,
      "pose_rmse_mean": 0.49989017844200134,
      "rmse_dtheta": 0.0614948533475399,
      "rmse_dx": 0.02842300571501255,
      "rmse_dy": 0.036362502723932266,
      "rmse_mean": 0.04209345579147339,
      "rotation_flip": 0.007905138656497002,
      "sparse_tokens": 4579.0,
      "step": 3717,
      "turn_loss": 0.6377654671669006,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 25879.0,
      "epoch": 0.1727374094034566,
      "grad_norm": 0.8515541553497314,
      "learning_rate": 7.903514778554699e-06,
      "loss": 0.2684,
      "mae_dtheta": 0.03456641733646393,
      "mae_dx": 0.01044157613068819,
      "mae_dy": 0.005472427234053612,
      "pose_mae_dtheta": 0.27618059515953064,
      "pose_mae_dx": 0.07674584537744522,
      "pose_mae_dy": 0.06521039456129074,
      "pose_rmse_dtheta": 0.5109297633171082,
      "pose_rmse_dx": 0.175989031791687,
      "pose_rmse_dy": 0.1398961991071701,
      "pose_rmse_mean": 0.2756050229072571,
      "rmse_dtheta": 0.053387369960546494,
      "rmse_dx": 0.022189345210790634,
      "rmse_dy": 0.010691233910620213,
      "rmse_mean": 0.02875598333775997,
      "rotation_flip": 0.012594458647072315,
      "sparse_tokens": 21202.0,
      "step": 3718,
      "turn_loss": 0.24559107422828674,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 37522.0,
      "epoch": 0.1727838691692994,
      "grad_norm": 0.8668320178985596,
      "learning_rate": 7.902438237932429e-06,
      "loss": 0.2808,
      "mae_dtheta": 0.03282609581947327,
      "mae_dx": 0.01226835884153843,
      "mae_dy": 0.004891062155365944,
      "pose_mae_dtheta": 0.2663288414478302,
      "pose_mae_dx": 0.10333050042390823,
      "pose_mae_dy": 0.06557291001081467,
      "pose_rmse_dtheta": 0.44134438037872314,
      "pose_rmse_dx": 0.2191610336303711,
      "pose_rmse_dy": 0.1528092622756958,
      "pose_rmse_mean": 0.2711049020290375,
      "rmse_dtheta": 0.04886230453848839,
      "rmse_dx": 0.024512192234396935,
      "rmse_dy": 0.01014450378715992,
      "rmse_mean": 0.027839666232466698,
      "rotation_flip": 0.010644588619470596,
      "sparse_tokens": 29722.0,
      "step": 3719,
      "turn_loss": 0.29459163546562195,
      "turns": 116.0,
      "turns_per_sample": 116.0
    },
    {
      "dense_tokens": 20710.0,
      "epoch": 0.17283032893514216,
      "grad_norm": 0.5706533789634705,
      "learning_rate": 7.901361494341093e-06,
      "loss": 0.1565,
      "mae_dtheta": 0.054797183722257614,
      "mae_dx": 0.013133438304066658,
      "mae_dy": 0.0067360312677919865,
      "pose_mae_dtheta": 0.4827185273170471,
      "pose_mae_dx": 0.12292202562093735,
      "pose_mae_dy": 0.08628670871257782,
      "pose_rmse_dtheta": 0.7491428852081299,
      "pose_rmse_dx": 0.25537848472595215,
      "pose_rmse_dy": 0.1932055950164795,
      "pose_rmse_mean": 0.3992423415184021,
      "rmse_dtheta": 0.07390864193439484,
      "rmse_dx": 0.0255082156509161,
      "rmse_dy": 0.013719367794692516,
      "rmse_mean": 0.03771207481622696,
      "rotation_flip": 0.014436958357691765,
      "sparse_tokens": 16010.0,
      "step": 3720,
      "turn_loss": 0.4217122495174408,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.17287678870098494,
      "grad_norm": 0.4778420925140381,
      "learning_rate": 7.900284547855992e-06,
      "loss": 0.1362,
      "mae_dtheta": 0.03674278408288956,
      "mae_dx": 0.014696719124913216,
      "mae_dy": 0.00542146060615778,
      "pose_mae_dtheta": 0.34354567527770996,
      "pose_mae_dx": 0.13798172771930695,
      "pose_mae_dy": 0.0699450820684433,
      "pose_rmse_dtheta": 0.6017451286315918,
      "pose_rmse_dx": 0.26686346530914307,
      "pose_rmse_dy": 0.15040580928325653,
      "pose_rmse_mean": 0.33967146277427673,
      "rmse_dtheta": 0.05772363021969795,
      "rmse_dx": 0.027685385197401047,
      "rmse_dy": 0.009881106205284595,
      "rmse_mean": 0.03176337480545044,
      "rotation_flip": 0.009433962404727936,
      "sparse_tokens": 8882.0,
      "step": 3721,
      "turn_loss": 0.3214814066886902,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.17292324846682772,
      "grad_norm": 0.5670413970947266,
      "learning_rate": 7.899207398552435e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.030036265030503273,
      "mae_dx": 0.012230681255459785,
      "mae_dy": 0.0060826437547802925,
      "pose_mae_dtheta": 0.23445095121860504,
      "pose_mae_dx": 0.1050657331943512,
      "pose_mae_dy": 0.0669519305229187,
      "pose_rmse_dtheta": 0.42126622796058655,
      "pose_rmse_dx": 0.23340286314487457,
      "pose_rmse_dy": 0.15715301036834717,
      "pose_rmse_mean": 0.2706073820590973,
      "rmse_dtheta": 0.04780537635087967,
      "rmse_dx": 0.02504306472837925,
      "rmse_dy": 0.012743450701236725,
      "rmse_mean": 0.028530631214380264,
      "rotation_flip": 0.015135135501623154,
      "sparse_tokens": 18886.0,
      "step": 3722,
      "turn_loss": 0.2784748375415802,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 11055.0,
      "epoch": 0.1729697082326705,
      "grad_norm": 0.4533725380897522,
      "learning_rate": 7.898130046505748e-06,
      "loss": 0.1486,
      "mae_dtheta": 0.03710741549730301,
      "mae_dx": 0.016692442819476128,
      "mae_dy": 0.006306493189185858,
      "pose_mae_dtheta": 0.2942028045654297,
      "pose_mae_dx": 0.14880415797233582,
      "pose_mae_dy": 0.11292140185832977,
      "pose_rmse_dtheta": 0.43045514822006226,
      "pose_rmse_dx": 0.3080436885356903,
      "pose_rmse_dy": 0.1997377723455429,
      "pose_rmse_mean": 0.3127455413341522,
      "rmse_dtheta": 0.05005667731165886,
      "rmse_dx": 0.03148641437292099,
      "rmse_dy": 0.010311217978596687,
      "rmse_mean": 0.030618101358413696,
      "rotation_flip": 0.018656715750694275,
      "sparse_tokens": 8681.0,
      "step": 3723,
      "turn_loss": 0.3688088059425354,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1730161679985133,
      "grad_norm": 0.37078654766082764,
      "learning_rate": 7.897052491791273e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.012666084803640842,
      "mae_dx": 0.0025005904026329517,
      "mae_dy": 0.002815718064084649,
      "pose_mae_dtheta": 0.09308115392923355,
      "pose_mae_dx": 0.02873915247619152,
      "pose_mae_dy": 0.025158900767564774,
      "pose_rmse_dtheta": 0.2470206618309021,
      "pose_rmse_dx": 0.08724893629550934,
      "pose_rmse_dy": 0.05723363533616066,
      "pose_rmse_mean": 0.13050107657909393,
      "rmse_dtheta": 0.03032449446618557,
      "rmse_dx": 0.008024504408240318,
      "rmse_dy": 0.008409515023231506,
      "rmse_mean": 0.015586171299219131,
      "rotation_flip": 0.0018375597428530455,
      "sparse_tokens": 32153.0,
      "step": 3724,
      "turn_loss": 0.12183917313814163,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.17306262776435608,
      "grad_norm": 0.40065744519233704,
      "learning_rate": 7.895974734484362e-06,
      "loss": 0.0875,
      "mae_dtheta": 0.010729603469371796,
      "mae_dx": 0.0016360183944925666,
      "mae_dy": 0.001418182160705328,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4006575345993042,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.90277099609375,
      "model/head/act_norm_mean": 118.27284564393939,
      "model/head/act_norm_min": 67.61815643310547,
      "model/head/act_over_embed": 81.27820681434167,
      "model/head/grad_frac": 0.1089598536491394,
      "model/head/grad_norm": 0.04365558549761772,
      "model/head/grad_zero_frac": 0.00017989308980759233,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6873914930555556,
      "model/head/update_ratio": 0.0007510554860346019,
      "model/head/weight_delta": 7.188927173614502,
      "model/head/weight_delta_rel": 0.12611506879329681,
      "model/head/weight_norm": 58.12564468383789,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4169943332672119,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41692678308697,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4168725311756134,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.286515988667407,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09489117562770844,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03801886364817619,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5454639317180616,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012319571105763316,
      "model/modality_embedder.encoders.pose/weight_delta": 2.3590073585510254,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07707612216472626,
      "model/modality_embedder.encoders.pose/weight_norm": 30.86054039001465,
      "model/modality_embedder/grad_frac": 0.09489117562770844,
      "model/modality_embedder/grad_norm": 0.03801886364817619,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5454639317180616,
      "model/modality_embedder/update_ratio": 0.0012319571105763316,
      "model/modality_embedder/weight_delta": 2.3590073585510254,
      "model/modality_embedder/weight_delta_rel": 0.07707612216472626,
      "model/modality_embedder/weight_norm": 30.86054039001465,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.72517395019531,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.328808922558924,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.08735179901123,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.7189852614802,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08081473410129547,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03237903118133545,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011676338035613298,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.6586846113204956,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.060443468391895294,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.730466842651367,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 82.16512298583984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.38594025573192,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.231142044067383,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.445455810656153,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07619759440422058,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030529139563441277,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010389296803623438,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.0954949855804443,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07258958369493484,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.385183334350586,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.73786926269531,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.322022306397308,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.423500061035156,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.775949521759145,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07301424443721771,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.029253706336021423,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009643703233450651,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.246098756790161,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07541979104280472,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.334514617919922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.66043853759766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.127109387526055,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.49145793914795,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.01642226340233,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0706486850976944,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02830592915415764,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009544327622279525,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.916649580001831,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06550198793411255,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.657331466674805,
      "model/normalizer/grad_frac": 0.3052111268043518,
      "model/normalizer/grad_norm": 0.1222851425409317,
      "model/normalizer/grad_zero_frac": 0.00020325901277828962,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0015632164431735873,
      "model/normalizer/weight_delta": 4.076165199279785,
      "model/normalizer/weight_delta_rel": 0.05249864608049393,
      "model/normalizer/weight_norm": 78.22662353515625,
      "pose_mae_dtheta": 0.07853402197360992,
      "pose_mae_dx": 0.01826564036309719,
      "pose_mae_dy": 0.019582876935601234,
      "pose_rmse_dtheta": 0.24599884450435638,
      "pose_rmse_dx": 0.04321175441145897,
      "pose_rmse_dy": 0.04836616665124893,
      "pose_rmse_mean": 0.1125255823135376,
      "rmse_dtheta": 0.027092361822724342,
      "rmse_dx": 0.004903167020529509,
      "rmse_dy": 0.003126229392364621,
      "rmse_mean": 0.011707252822816372,
      "rotation_flip": 0.0025521055795252323,
      "sparse_tokens": 32137.0,
      "step": 3725,
      "turn_loss": 0.0669655129313469,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.17310908753019885,
      "grad_norm": 0.7864633798599243,
      "learning_rate": 7.894896774660382e-06,
      "loss": 0.2164,
      "mae_dtheta": 0.04069919511675835,
      "mae_dx": 0.009143946692347527,
      "mae_dy": 0.003953046631067991,
      "pose_mae_dtheta": 0.3179055154323578,
      "pose_mae_dx": 0.06283377856016159,
      "pose_mae_dy": 0.050576359033584595,
      "pose_rmse_dtheta": 0.5683886408805847,
      "pose_rmse_dx": 0.14004625380039215,
      "pose_rmse_dy": 0.13034537434577942,
      "pose_rmse_mean": 0.27959343791007996,
      "rmse_dtheta": 0.061481308192014694,
      "rmse_dx": 0.01902993954718113,
      "rmse_dy": 0.008691741153597832,
      "rmse_mean": 0.029734332114458084,
      "rotation_flip": 0.006075334269553423,
      "sparse_tokens": 13211.0,
      "step": 3726,
      "turn_loss": 0.273229718208313,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.17315554729604163,
      "grad_norm": 0.47805801033973694,
      "learning_rate": 7.893818612394717e-06,
      "loss": 0.106,
      "mae_dtheta": 0.031021716073155403,
      "mae_dx": 0.011089425534009933,
      "mae_dy": 0.003408632008358836,
      "pose_mae_dtheta": 0.2470914125442505,
      "pose_mae_dx": 0.09327302873134613,
      "pose_mae_dy": 0.04786000773310661,
      "pose_rmse_dtheta": 0.4835844933986664,
      "pose_rmse_dx": 0.21783877909183502,
      "pose_rmse_dy": 0.11319434642791748,
      "pose_rmse_mean": 0.27153921127319336,
      "rmse_dtheta": 0.051984429359436035,
      "rmse_dx": 0.023959066718816757,
      "rmse_dy": 0.0064717745408415794,
      "rmse_mean": 0.02747175842523575,
      "rotation_flip": 0.0076530613005161285,
      "sparse_tokens": 17489.0,
      "step": 3727,
      "turn_loss": 0.27568256855010986,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.1732020070618844,
      "grad_norm": 0.8797193765640259,
      "learning_rate": 7.892740247762764e-06,
      "loss": 0.273,
      "mae_dtheta": 0.05588320642709732,
      "mae_dx": 0.016925007104873657,
      "mae_dy": 0.0024928601924329996,
      "pose_mae_dtheta": 0.5049790740013123,
      "pose_mae_dx": 0.14435280859470367,
      "pose_mae_dy": 0.033462781459093094,
      "pose_rmse_dtheta": 0.7414364814758301,
      "pose_rmse_dx": 0.3163227140903473,
      "pose_rmse_dy": 0.07778362929821014,
      "pose_rmse_mean": 0.37851426005363464,
      "rmse_dtheta": 0.07105743885040283,
      "rmse_dx": 0.031012140214443207,
      "rmse_dy": 0.005838209763169289,
      "rmse_mean": 0.035969264805316925,
      "rotation_flip": 0.014627659693360329,
      "sparse_tokens": 10830.0,
      "step": 3728,
      "turn_loss": 0.398120254278183,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17324846682772718,
      "grad_norm": 0.42105233669281006,
      "learning_rate": 7.891661680839932e-06,
      "loss": 0.0978,
      "mae_dtheta": 0.012999298050999641,
      "mae_dx": 0.002975962357595563,
      "mae_dy": 0.004549780394881964,
      "pose_mae_dtheta": 0.0901731327176094,
      "pose_mae_dx": 0.034998659044504166,
      "pose_mae_dy": 0.0416744239628315,
      "pose_rmse_dtheta": 0.16910839080810547,
      "pose_rmse_dx": 0.08784671127796173,
      "pose_rmse_dy": 0.08494748920202255,
      "pose_rmse_mean": 0.11396753042936325,
      "rmse_dtheta": 0.022327542304992676,
      "rmse_dx": 0.008301193825900555,
      "rmse_dy": 0.009944208897650242,
      "rmse_mean": 0.013524315319955349,
      "rotation_flip": 0.0050093927420675755,
      "sparse_tokens": 32089.0,
      "step": 3729,
      "turn_loss": 0.12191944569349289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.17329492659356996,
      "grad_norm": 0.4435509741306305,
      "learning_rate": 7.890582911701649e-06,
      "loss": 0.1021,
      "mae_dtheta": 0.012884621508419514,
      "mae_dx": 0.0020019966177642345,
      "mae_dy": 0.0028543078806251287,
      "pose_mae_dtheta": 0.09113691747188568,
      "pose_mae_dx": 0.02395223081111908,
      "pose_mae_dy": 0.03144717216491699,
      "pose_rmse_dtheta": 0.21891875565052032,
      "pose_rmse_dx": 0.05122266337275505,
      "pose_rmse_dy": 0.06761124730110168,
      "pose_rmse_mean": 0.11258422583341599,
      "rmse_dtheta": 0.027126111090183258,
      "rmse_dx": 0.005198741797357798,
      "rmse_dy": 0.006113911047577858,
      "rmse_mean": 0.012812922708690166,
      "rotation_flip": 0.005126182921230793,
      "sparse_tokens": 32105.0,
      "step": 3730,
      "turn_loss": 0.1145978569984436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29523.0,
      "epoch": 0.17334138635941274,
      "grad_norm": 0.43790191411972046,
      "learning_rate": 7.88950394042335e-06,
      "loss": 0.13,
      "mae_dtheta": 0.03233738988637924,
      "mae_dx": 0.013352042995393276,
      "mae_dy": 0.004796881694346666,
      "pose_mae_dtheta": 0.2538750171661377,
      "pose_mae_dx": 0.10644163191318512,
      "pose_mae_dy": 0.056126389652490616,
      "pose_rmse_dtheta": 0.4582921266555786,
      "pose_rmse_dx": 0.23731409013271332,
      "pose_rmse_dy": 0.1490696370601654,
      "pose_rmse_mean": 0.281558632850647,
      "rmse_dtheta": 0.050397880375385284,
      "rmse_dx": 0.02700190432369709,
      "rmse_dy": 0.010855169035494328,
      "rmse_mean": 0.02941831760108471,
      "rotation_flip": 0.00753012066707015,
      "sparse_tokens": 23691.0,
      "step": 3731,
      "turn_loss": 0.24614904820919037,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.17338784612525554,
      "grad_norm": 0.6392427086830139,
      "learning_rate": 7.888424767080489e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.012352896854281425,
      "mae_dx": 0.0020305353682488203,
      "mae_dy": 0.0019375622505322099,
      "pose_mae_dtheta": 0.092192143201828,
      "pose_mae_dx": 0.027470089495182037,
      "pose_mae_dy": 0.02543880231678486,
      "pose_rmse_dtheta": 0.26355212926864624,
      "pose_rmse_dx": 0.061009589582681656,
      "pose_rmse_dy": 0.06736317276954651,
      "pose_rmse_mean": 0.1306416392326355,
      "rmse_dtheta": 0.029780853539705276,
      "rmse_dx": 0.0049180225469172,
      "rmse_dy": 0.004594164900481701,
      "rmse_mean": 0.013097681105136871,
      "rotation_flip": 0.0020136930979788303,
      "sparse_tokens": 32185.0,
      "step": 3732,
      "turn_loss": 0.07827489078044891,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.17343430589109832,
      "grad_norm": 1.340590238571167,
      "learning_rate": 7.887345391748533e-06,
      "loss": 0.2057,
      "mae_dtheta": 0.029586799442768097,
      "mae_dx": 0.009339991956949234,
      "mae_dy": 0.0059578088112175465,
      "pose_mae_dtheta": 0.2593447268009186,
      "pose_mae_dx": 0.08289102464914322,
      "pose_mae_dy": 0.060837678611278534,
      "pose_rmse_dtheta": 0.41481295228004456,
      "pose_rmse_dx": 0.1831345409154892,
      "pose_rmse_dy": 0.14049243927001953,
      "pose_rmse_mean": 0.24614664912223816,
      "rmse_dtheta": 0.044005442410707474,
      "rmse_dx": 0.02010994777083397,
      "rmse_dy": 0.01090259663760662,
      "rmse_mean": 0.025005996227264404,
      "rotation_flip": 0.012787723913788795,
      "sparse_tokens": 14683.0,
      "step": 3733,
      "turn_loss": 0.21228930354118347,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1734807656569411,
      "grad_norm": 0.5317574143409729,
      "learning_rate": 7.886265814502967e-06,
      "loss": 0.1454,
      "mae_dtheta": 0.016887117177248,
      "mae_dx": 0.003214007243514061,
      "mae_dy": 0.00409671338275075,
      "pose_mae_dtheta": 0.1174185648560524,
      "pose_mae_dx": 0.03840360417962074,
      "pose_mae_dy": 0.04244488850235939,
      "pose_rmse_dtheta": 0.26394179463386536,
      "pose_rmse_dx": 0.09520522505044937,
      "pose_rmse_dy": 0.08795394003391266,
      "pose_rmse_mean": 0.14903365075588226,
      "rmse_dtheta": 0.031715620309114456,
      "rmse_dx": 0.008864495903253555,
      "rmse_dy": 0.00853302888572216,
      "rmse_mean": 0.016371048986911774,
      "rotation_flip": 0.0048250905238091946,
      "sparse_tokens": 32153.0,
      "step": 3734,
      "turn_loss": 0.14380748569965363,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.17352722542278387,
      "grad_norm": 0.5481761693954468,
      "learning_rate": 7.885186035419281e-06,
      "loss": 0.1523,
      "mae_dtheta": 0.03192683681845665,
      "mae_dx": 0.014124956913292408,
      "mae_dy": 0.0038884072564542294,
      "pose_mae_dtheta": 0.24764101207256317,
      "pose_mae_dx": 0.10651079565286636,
      "pose_mae_dy": 0.04569953680038452,
      "pose_rmse_dtheta": 0.4218633472919464,
      "pose_rmse_dx": 0.2157348245382309,
      "pose_rmse_dy": 0.1069871187210083,
      "pose_rmse_mean": 0.2481950968503952,
      "rmse_dtheta": 0.04767550900578499,
      "rmse_dx": 0.0262066051363945,
      "rmse_dy": 0.007294292561709881,
      "rmse_mean": 0.027058802545070648,
      "rotation_flip": 0.016190476715564728,
      "sparse_tokens": 19095.0,
      "step": 3735,
      "turn_loss": 0.29596564173698425,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.17357368518862665,
      "grad_norm": 1.24442720413208,
      "learning_rate": 7.884106054572987e-06,
      "loss": 0.141,
      "mae_dtheta": 0.030166856944561005,
      "mae_dx": 0.010379853658378124,
      "mae_dy": 0.005705858580768108,
      "pose_mae_dtheta": 0.21682366728782654,
      "pose_mae_dx": 0.07570803910493851,
      "pose_mae_dy": 0.06620502471923828,
      "pose_rmse_dtheta": 0.36446431279182434,
      "pose_rmse_dx": 0.13879035413265228,
      "pose_rmse_dy": 0.1287105530500412,
      "pose_rmse_mean": 0.210655078291893,
      "rmse_dtheta": 0.04601907357573509,
      "rmse_dx": 0.02004142850637436,
      "rmse_dy": 0.0090005062520504,
      "rmse_mean": 0.025020336732268333,
      "rotation_flip": 0.011428571306169033,
      "sparse_tokens": 3747.0,
      "step": 3736,
      "turn_loss": 0.3080959618091583,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.17362014495446942,
      "grad_norm": 0.5325829386711121,
      "learning_rate": 7.883025872039609e-06,
      "loss": 0.1054,
      "mae_dtheta": 0.03901580721139908,
      "mae_dx": 0.015265190973877907,
      "mae_dy": 0.005433696787804365,
      "pose_mae_dtheta": 0.32942140102386475,
      "pose_mae_dx": 0.14411574602127075,
      "pose_mae_dy": 0.052745576947927475,
      "pose_rmse_dtheta": 0.5295438766479492,
      "pose_rmse_dx": 0.3008826673030853,
      "pose_rmse_dy": 0.1095285415649414,
      "pose_rmse_mean": 0.3133183717727661,
      "rmse_dtheta": 0.057172972708940506,
      "rmse_dx": 0.029275478795170784,
      "rmse_dy": 0.009549274109303951,
      "rmse_mean": 0.031999245285987854,
      "rotation_flip": 0.0058139534667134285,
      "sparse_tokens": 5370.0,
      "step": 3737,
      "turn_loss": 0.3127795159816742,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.1736666047203122,
      "grad_norm": 0.6278413534164429,
      "learning_rate": 7.881945487894684e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.03738601505756378,
      "mae_dx": 0.010318254120647907,
      "mae_dy": 0.0045512355864048,
      "pose_mae_dtheta": 0.31870952248573303,
      "pose_mae_dx": 0.06134802848100662,
      "pose_mae_dy": 0.05970127880573273,
      "pose_rmse_dtheta": 0.512518584728241,
      "pose_rmse_dx": 0.17235440015792847,
      "pose_rmse_dy": 0.14152564108371735,
      "pose_rmse_mean": 0.2754662036895752,
      "rmse_dtheta": 0.05365060269832611,
      "rmse_dx": 0.02276245877146721,
      "rmse_dy": 0.008960134349763393,
      "rmse_mean": 0.02845773473381996,
      "rotation_flip": 0.015283842571079731,
      "sparse_tokens": 8593.0,
      "step": 3738,
      "turn_loss": 0.24580247700214386,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.17371306448615498,
      "grad_norm": 0.5482691526412964,
      "learning_rate": 7.880864902213765e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.005070940591394901,
      "mae_dx": 0.001551767229102552,
      "mae_dy": 0.0007021734490990639,
      "pose_mae_dtheta": 0.04008118435740471,
      "pose_mae_dx": 0.013150650076568127,
      "pose_mae_dy": 0.012009579688310623,
      "pose_rmse_dtheta": 0.11109914630651474,
      "pose_rmse_dx": 0.03601367026567459,
      "pose_rmse_dy": 0.0350496880710125,
      "pose_rmse_mean": 0.060720838606357574,
      "rmse_dtheta": 0.014899571426212788,
      "rmse_dx": 0.005338919349014759,
      "rmse_dy": 0.0015336137730628252,
      "rmse_mean": 0.007257368415594101,
      "rotation_flip": 0.005464480724185705,
      "sparse_tokens": 32153.0,
      "step": 3739,
      "turn_loss": 0.03938073664903641,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2946.0,
      "epoch": 0.17375952425199778,
      "grad_norm": 0.6519472002983093,
      "learning_rate": 7.879784115072418e-06,
      "loss": 0.097,
      "mae_dtheta": 0.04463423788547516,
      "mae_dx": 0.01288498006761074,
      "mae_dy": 0.009035345166921616,
      "pose_mae_dtheta": 0.4204145669937134,
      "pose_mae_dx": 0.08943229168653488,
      "pose_mae_dy": 0.1422012895345688,
      "pose_rmse_dtheta": 0.6988593935966492,
      "pose_rmse_dx": 0.17334306240081787,
      "pose_rmse_dy": 0.22944660484790802,
      "pose_rmse_mean": 0.3672163486480713,
      "rmse_dtheta": 0.0603644922375679,
      "rmse_dx": 0.021177036687731743,
      "rmse_dy": 0.01386326365172863,
      "rmse_mean": 0.03180160000920296,
      "rotation_flip": 0.007246376946568489,
      "sparse_tokens": 2408.0,
      "step": 3740,
      "turn_loss": 0.3344806134700775,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17380598401784056,
      "grad_norm": 0.4202997386455536,
      "learning_rate": 7.87870312654622e-06,
      "loss": 0.119,
      "mae_dtheta": 0.010179483331739902,
      "mae_dx": 0.0013968185521662235,
      "mae_dy": 0.0017706563230603933,
      "pose_mae_dtheta": 0.07141755521297455,
      "pose_mae_dx": 0.016652563586831093,
      "pose_mae_dy": 0.02658631093800068,
      "pose_rmse_dtheta": 0.19350872933864594,
      "pose_rmse_dx": 0.03975507616996765,
      "pose_rmse_dy": 0.061685796827077866,
      "pose_rmse_mean": 0.09831653535366058,
      "rmse_dtheta": 0.02548114024102688,
      "rmse_dx": 0.004186210688203573,
      "rmse_dy": 0.0037010700907558203,
      "rmse_mean": 0.011122806929051876,
      "rotation_flip": 0.0034980324562639,
      "sparse_tokens": 32089.0,
      "step": 3741,
      "turn_loss": 0.07674860954284668,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.17385244378368334,
      "grad_norm": 0.35232433676719666,
      "learning_rate": 7.877621936710768e-06,
      "loss": 0.0878,
      "mae_dtheta": 0.00727875204756856,
      "mae_dx": 0.0018098971340805292,
      "mae_dy": 0.0011229711817577481,
      "pose_mae_dtheta": 0.054859764873981476,
      "pose_mae_dx": 0.01875138096511364,
      "pose_mae_dy": 0.015798356384038925,
      "pose_rmse_dtheta": 0.17724697291851044,
      "pose_rmse_dx": 0.0552976168692112,
      "pose_rmse_dy": 0.04140547290444374,
      "pose_rmse_mean": 0.09131669253110886,
      "rmse_dtheta": 0.021230733022093773,
      "rmse_dx": 0.005456672050058842,
      "rmse_dy": 0.0026072401087731123,
      "rmse_mean": 0.009764881804585457,
      "rotation_flip": 0.001080497051589191,
      "sparse_tokens": 32153.0,
      "step": 3742,
      "turn_loss": 0.05062958598136902,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.1738989035495261,
      "grad_norm": 0.8149752616882324,
      "learning_rate": 7.87654054564167e-06,
      "loss": 0.1611,
      "mae_dtheta": 0.033159270882606506,
      "mae_dx": 0.0125191118568182,
      "mae_dy": 0.009694794192910194,
      "pose_mae_dtheta": 0.22735047340393066,
      "pose_mae_dx": 0.1158934235572815,
      "pose_mae_dy": 0.08542150259017944,
      "pose_rmse_dtheta": 0.36973837018013,
      "pose_rmse_dx": 0.23548412322998047,
      "pose_rmse_dy": 0.20732489228248596,
      "pose_rmse_mean": 0.2708491086959839,
      "rmse_dtheta": 0.04821131378412247,
      "rmse_dx": 0.02379121258854866,
      "rmse_dy": 0.02081146463751793,
      "rmse_mean": 0.030937999486923218,
      "rotation_flip": 0.0,
      "sparse_tokens": 6573.0,
      "step": 3743,
      "turn_loss": 0.4082731008529663,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1739453633153689,
      "grad_norm": 0.6390851140022278,
      "learning_rate": 7.875458953414547e-06,
      "loss": 0.0843,
      "mae_dtheta": 0.007788996212184429,
      "mae_dx": 0.0022772124502807856,
      "mae_dy": 0.0014007838908582926,
      "pose_mae_dtheta": 0.05921338498592377,
      "pose_mae_dx": 0.018405795097351074,
      "pose_mae_dy": 0.015449317172169685,
      "pose_rmse_dtheta": 0.18678387999534607,
      "pose_rmse_dx": 0.062078144401311874,
      "pose_rmse_dy": 0.03893433138728142,
      "pose_rmse_mean": 0.09593211859464645,
      "rmse_dtheta": 0.021669337525963783,
      "rmse_dx": 0.007822606712579727,
      "rmse_dy": 0.004874744452536106,
      "rmse_mean": 0.011455563828349113,
      "rotation_flip": 0.00745257455855608,
      "sparse_tokens": 32073.0,
      "step": 3744,
      "turn_loss": 0.057207588106393814,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.17399182308121167,
      "grad_norm": 0.7457666993141174,
      "learning_rate": 7.874377160105037e-06,
      "loss": 0.1513,
      "mae_dtheta": 0.03846628963947296,
      "mae_dx": 0.015265168622136116,
      "mae_dy": 0.006089124828577042,
      "pose_mae_dtheta": 0.2856457233428955,
      "pose_mae_dx": 0.12323185801506042,
      "pose_mae_dy": 0.09380786865949631,
      "pose_rmse_dtheta": 0.4432331919670105,
      "pose_rmse_dx": 0.26662641763687134,
      "pose_rmse_dy": 0.1715044230222702,
      "pose_rmse_mean": 0.29378801584243774,
      "rmse_dtheta": 0.05345899239182472,
      "rmse_dx": 0.02905086614191532,
      "rmse_dy": 0.009543565101921558,
      "rmse_mean": 0.03068447671830654,
      "rotation_flip": 0.01173020526766777,
      "sparse_tokens": 6106.0,
      "step": 3745,
      "turn_loss": 0.28413498401641846,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.17403828284705444,
      "grad_norm": 0.5736364722251892,
      "learning_rate": 7.873295165788787e-06,
      "loss": 0.1331,
      "mae_dtheta": 0.013678479939699173,
      "mae_dx": 0.0023949856404215097,
      "mae_dy": 0.003670674515888095,
      "pose_mae_dtheta": 0.08845911175012589,
      "pose_mae_dx": 0.029625896364450455,
      "pose_mae_dy": 0.03559618815779686,
      "pose_rmse_dtheta": 0.2350151240825653,
      "pose_rmse_dx": 0.06755118817090988,
      "pose_rmse_dy": 0.080588199198246,
      "pose_rmse_mean": 0.12771818041801453,
      "rmse_dtheta": 0.028232678771018982,
      "rmse_dx": 0.007034032605588436,
      "rmse_dy": 0.0074816131964325905,
      "rmse_mean": 0.014249442145228386,
      "rotation_flip": 0.009120521135628223,
      "sparse_tokens": 32121.0,
      "step": 3746,
      "turn_loss": 0.10825544595718384,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.17408474261289722,
      "grad_norm": 0.49251946806907654,
      "learning_rate": 7.872212970541468e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.011987646110355854,
      "mae_dx": 0.001990211894735694,
      "mae_dy": 0.0026173244696110487,
      "pose_mae_dtheta": 0.07896151393651962,
      "pose_mae_dx": 0.026073794811964035,
      "pose_mae_dy": 0.02862861193716526,
      "pose_rmse_dtheta": 0.18305028975009918,
      "pose_rmse_dx": 0.05841992050409317,
      "pose_rmse_dy": 0.058957163244485855,
      "pose_rmse_mean": 0.1001424640417099,
      "rmse_dtheta": 0.0239089448004961,
      "rmse_dx": 0.005418149288743734,
      "rmse_dy": 0.005114533007144928,
      "rmse_mean": 0.011480542831122875,
      "rotation_flip": 0.006747638341039419,
      "sparse_tokens": 32121.0,
      "step": 3747,
      "turn_loss": 0.07938734441995621,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17413120237874002,
      "grad_norm": 0.6233845949172974,
      "learning_rate": 7.871130574438753e-06,
      "loss": 0.1409,
      "mae_dtheta": 0.014369219541549683,
      "mae_dx": 0.004124471917748451,
      "mae_dy": 0.005329488310962915,
      "pose_mae_dtheta": 0.1011062040925026,
      "pose_mae_dx": 0.04783251881599426,
      "pose_mae_dy": 0.051992565393447876,
      "pose_rmse_dtheta": 0.22640962898731232,
      "pose_rmse_dx": 0.12221308797597885,
      "pose_rmse_dy": 0.15405049920082092,
      "pose_rmse_mean": 0.1675577461719513,
      "rmse_dtheta": 0.027297023683786392,
      "rmse_dx": 0.010751868598163128,
      "rmse_dy": 0.012437021359801292,
      "rmse_mean": 0.016828639432787895,
      "rotation_flip": 0.006032171659171581,
      "sparse_tokens": 32089.0,
      "step": 3748,
      "turn_loss": 0.13629533350467682,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1017.0,
      "epoch": 0.1741776621445828,
      "grad_norm": 0.6204614639282227,
      "learning_rate": 7.870047977556335e-06,
      "loss": 0.1387,
      "mae_dtheta": 0.021100806072354317,
      "mae_dx": 0.016516903415322304,
      "mae_dy": 0.014689507894217968,
      "pose_mae_dtheta": 0.14997708797454834,
      "pose_mae_dx": 0.036721114069223404,
      "pose_mae_dy": 0.16707029938697815,
      "pose_rmse_dtheta": 0.21784213185310364,
      "pose_rmse_dx": 0.05249913036823273,
      "pose_rmse_dy": 0.3044549226760864,
      "pose_rmse_mean": 0.19159874320030212,
      "rmse_dtheta": 0.028245920315384865,
      "rmse_dx": 0.02974817529320717,
      "rmse_dy": 0.017709873616695404,
      "rmse_mean": 0.025234658271074295,
      "rotation_flip": 0.0,
      "sparse_tokens": 972.0,
      "step": 3749,
      "turn_loss": 0.5206941962242126,
      "turns": 3.0,
      "turns_per_sample": 3.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.17422412191042558,
      "grad_norm": 0.48109471797943115,
      "learning_rate": 7.86896517996992e-06,
      "loss": 0.1189,
      "mae_dtheta": 0.010991688817739487,
      "mae_dx": 0.0019788495264947414,
      "mae_dy": 0.0029123546555638313,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4810947775840759,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.3663787841797,
      "model/head/act_norm_mean": 111.60197679924242,
      "model/head/act_norm_min": 62.71781539916992,
      "model/head/act_over_embed": 76.69392329060781,
      "model/head/grad_frac": 0.10285080969333649,
      "model/head/grad_norm": 0.04948098585009575,
      "model/head/grad_zero_frac": 0.00017576856771484017,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6965406013257576,
      "model/head/update_ratio": 0.0008511877967976034,
      "model/head/weight_delta": 7.217177391052246,
      "model/head/weight_delta_rel": 0.126610666513443,
      "model/head/weight_norm": 58.131690979003906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4170745313167572,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4170048683201341,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4169372022151947,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28656964957068287,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08865109086036682,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04264957830309868,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5334350028538812,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001381970476359129,
      "model/modality_embedder.encoders.pose/weight_delta": 2.363995313644409,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07723909616470337,
      "model/modality_embedder.encoders.pose/weight_norm": 30.861425399780273,
      "model/modality_embedder/grad_frac": 0.08865109086036682,
      "model/modality_embedder/grad_norm": 0.04264957830309868,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5334350028538812,
      "model/modality_embedder/update_ratio": 0.001381970476359129,
      "model/modality_embedder/weight_delta": 2.363995313644409,
      "model/modality_embedder/weight_delta_rel": 0.07723909616470337,
      "model/modality_embedder/weight_norm": 30.861425399780273,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.2164535522461,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.742797518839186,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.009429931640625,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.316272738518794,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0829041600227356,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03988475725054741,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014382262015715241,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.667763113975525,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.060774292796850204,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.731908798217773,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.84684753417969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.80171005691839,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.266156196594238,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.0439673483822,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08822699636220932,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04244554787874222,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014443070394918323,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.105778932571411,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07294582575559616,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.38817596435547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.76020050048828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.738551186467852,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.036578178405762,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.37498270560093,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09114828705787659,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.043850965797901154,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014453947078436613,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.2585573196411133,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0758381262421608,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.338401794433594,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.54756164550781,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.624496452621454,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.482687950134277,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.671021948999453,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1047012135386467,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0503712072968483,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001698351581580937,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.9263159036636353,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06583233922719955,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.65888023376465,
      "model/normalizer/grad_frac": 0.43434086441993713,
      "model/normalizer/grad_norm": 0.20895911753177643,
      "model/normalizer/grad_zero_frac": 0.0001524442486697808,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0026710950769484043,
      "model/normalizer/weight_delta": 4.097450256347656,
      "model/normalizer/weight_delta_rel": 0.05277278646826744,
      "model/normalizer/weight_norm": 78.2297592163086,
      "pose_mae_dtheta": 0.07630423456430435,
      "pose_mae_dx": 0.027736064046621323,
      "pose_mae_dy": 0.029900433495640755,
      "pose_rmse_dtheta": 0.17316243052482605,
      "pose_rmse_dx": 0.07099911570549011,
      "pose_rmse_dy": 0.063024140894413,
      "pose_rmse_mean": 0.10239522904157639,
      "rmse_dtheta": 0.022954173386096954,
      "rmse_dx": 0.006013829726725817,
      "rmse_dy": 0.007154211401939392,
      "rmse_mean": 0.012040738016366959,
      "rotation_flip": 0.0031131096184253693,
      "sparse_tokens": 32073.0,
      "step": 3750,
      "turn_loss": 0.09613484144210815,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.17427058167626835,
      "grad_norm": 0.5368195176124573,
      "learning_rate": 7.86788218175523e-06,
      "loss": 0.1204,
      "mae_dtheta": 0.010782659985125065,
      "mae_dx": 0.0030224956572055817,
      "mae_dy": 0.002500874688848853,
      "pose_mae_dtheta": 0.07866668701171875,
      "pose_mae_dx": 0.02424892969429493,
      "pose_mae_dy": 0.023844586685299873,
      "pose_rmse_dtheta": 0.23384499549865723,
      "pose_rmse_dx": 0.06624094396829605,
      "pose_rmse_dy": 0.0787401869893074,
      "pose_rmse_mean": 0.12627537548542023,
      "rmse_dtheta": 0.027847599238157272,
      "rmse_dx": 0.008715050294995308,
      "rmse_dy": 0.008529567159712315,
      "rmse_mean": 0.015030739828944206,
      "rotation_flip": 0.004502660594880581,
      "sparse_tokens": 32217.0,
      "step": 3751,
      "turn_loss": 0.09850350767374039,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.17431704144211113,
      "grad_norm": 0.7523212432861328,
      "learning_rate": 7.866798982988002e-06,
      "loss": 0.2215,
      "mae_dtheta": 0.027338942512869835,
      "mae_dx": 0.008023032918572426,
      "mae_dy": 0.0034589238930493593,
      "pose_mae_dtheta": 0.22757278382778168,
      "pose_mae_dx": 0.07082432508468628,
      "pose_mae_dy": 0.025726770982146263,
      "pose_rmse_dtheta": 0.5052827596664429,
      "pose_rmse_dx": 0.1907668560743332,
      "pose_rmse_dy": 0.05637725815176964,
      "pose_rmse_mean": 0.2508089542388916,
      "rmse_dtheta": 0.04874836653470993,
      "rmse_dx": 0.019042981788516045,
      "rmse_dy": 0.008010328747332096,
      "rmse_mean": 0.0252672266215086,
      "rotation_flip": 0.0,
      "sparse_tokens": 4431.0,
      "step": 3752,
      "turn_loss": 0.19183838367462158,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1743635012079539,
      "grad_norm": 0.5835483074188232,
      "learning_rate": 7.865715583743983e-06,
      "loss": 0.1455,
      "mae_dtheta": 0.00952166598290205,
      "mae_dx": 0.0014704515924677253,
      "mae_dy": 0.002121463418006897,
      "pose_mae_dtheta": 0.060800231993198395,
      "pose_mae_dx": 0.019329790025949478,
      "pose_mae_dy": 0.023673055693507195,
      "pose_rmse_dtheta": 0.1539989560842514,
      "pose_rmse_dx": 0.05789179727435112,
      "pose_rmse_dy": 0.05301501229405403,
      "pose_rmse_mean": 0.08830192685127258,
      "rmse_dtheta": 0.020533746108412743,
      "rmse_dx": 0.0048013608902692795,
      "rmse_dy": 0.004936905577778816,
      "rmse_mean": 0.010090671479701996,
      "rotation_flip": 0.0059198541566729546,
      "sparse_tokens": 32073.0,
      "step": 3753,
      "turn_loss": 0.09075957536697388,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.17440996097379668,
      "grad_norm": 0.7824680209159851,
      "learning_rate": 7.864631984098933e-06,
      "loss": 0.1562,
      "mae_dtheta": 0.029619857668876648,
      "mae_dx": 0.010731366463005543,
      "mae_dy": 0.005222648847848177,
      "pose_mae_dtheta": 0.22294561564922333,
      "pose_mae_dx": 0.07682240754365921,
      "pose_mae_dy": 0.06407863646745682,
      "pose_rmse_dtheta": 0.3784315288066864,
      "pose_rmse_dx": 0.21105867624282837,
      "pose_rmse_dy": 0.1411900520324707,
      "pose_rmse_mean": 0.2435600757598877,
      "rmse_dtheta": 0.04412918910384178,
      "rmse_dx": 0.024580979719758034,
      "rmse_dy": 0.010189238935709,
      "rmse_mean": 0.02629980444908142,
      "rotation_flip": 0.003289473708719015,
      "sparse_tokens": 5437.0,
      "step": 3754,
      "turn_loss": 0.24673734605312347,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 30494.0,
      "epoch": 0.17445642073963946,
      "grad_norm": 0.5320703387260437,
      "learning_rate": 7.863548184128632e-06,
      "loss": 0.2063,
      "mae_dtheta": 0.032210271805524826,
      "mae_dx": 0.012936078011989594,
      "mae_dy": 0.004550174809992313,
      "pose_mae_dtheta": 0.2476639747619629,
      "pose_mae_dx": 0.10712601989507675,
      "pose_mae_dy": 0.0617910735309124,
      "pose_rmse_dtheta": 0.43684664368629456,
      "pose_rmse_dx": 0.24015243351459503,
      "pose_rmse_dy": 0.14872053265571594,
      "pose_rmse_mean": 0.27523988485336304,
      "rmse_dtheta": 0.04952183738350868,
      "rmse_dx": 0.025707662105560303,
      "rmse_dy": 0.00915885902941227,
      "rmse_mean": 0.028129450976848602,
      "rotation_flip": 0.013323464430868626,
      "sparse_tokens": 23029.0,
      "step": 3755,
      "turn_loss": 0.2567347288131714,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 4884.0,
      "epoch": 0.17450288050548224,
      "grad_norm": 0.8916082382202148,
      "learning_rate": 7.862464183908869e-06,
      "loss": 0.2476,
      "mae_dtheta": 0.028470629826188087,
      "mae_dx": 0.004374087322503328,
      "mae_dy": 0.003621123731136322,
      "pose_mae_dtheta": 0.21726100146770477,
      "pose_mae_dx": 0.03399531915783882,
      "pose_mae_dy": 0.029393015429377556,
      "pose_rmse_dtheta": 0.4319116175174713,
      "pose_rmse_dx": 0.07263854146003723,
      "pose_rmse_dy": 0.06650387495756149,
      "pose_rmse_mean": 0.19035135209560394,
      "rmse_dtheta": 0.047649871557950974,
      "rmse_dx": 0.009557240642607212,
      "rmse_dy": 0.007071167696267366,
      "rmse_mean": 0.021426094695925713,
      "rotation_flip": 0.007547169923782349,
      "sparse_tokens": 4048.0,
      "step": 3756,
      "turn_loss": 0.23402155935764313,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.17454934027132504,
      "grad_norm": 0.5616891980171204,
      "learning_rate": 7.861379983515449e-06,
      "loss": 0.1072,
      "mae_dtheta": 0.022778669372200966,
      "mae_dx": 0.010668920353055,
      "mae_dy": 0.0040315245278179646,
      "pose_mae_dtheta": 0.1634107381105423,
      "pose_mae_dx": 0.08650396019220352,
      "pose_mae_dy": 0.048257309943437576,
      "pose_rmse_dtheta": 0.33785954117774963,
      "pose_rmse_dx": 0.21323354542255402,
      "pose_rmse_dy": 0.11008314788341522,
      "pose_rmse_mean": 0.22039209306240082,
      "rmse_dtheta": 0.039173297584056854,
      "rmse_dx": 0.02299291267991066,
      "rmse_dy": 0.008327776566147804,
      "rmse_mean": 0.023497996851801872,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 18166.0,
      "step": 3757,
      "turn_loss": 0.20245298743247986,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.17459580003716782,
      "grad_norm": 0.5006604194641113,
      "learning_rate": 7.860295583024192e-06,
      "loss": 0.1155,
      "mae_dtheta": 0.02859850414097309,
      "mae_dx": 0.015591604635119438,
      "mae_dy": 0.0037863885518163443,
      "pose_mae_dtheta": 0.21354371309280396,
      "pose_mae_dx": 0.10741201043128967,
      "pose_mae_dy": 0.039264556020498276,
      "pose_rmse_dtheta": 0.348969042301178,
      "pose_rmse_dx": 0.22377832233905792,
      "pose_rmse_dy": 0.10037797689437866,
      "pose_rmse_mean": 0.22437511384487152,
      "rmse_dtheta": 0.04372584447264671,
      "rmse_dx": 0.028595993295311928,
      "rmse_dy": 0.007605532184243202,
      "rmse_mean": 0.026642456650733948,
      "rotation_flip": 0.018739352002739906,
      "sparse_tokens": 9244.0,
      "step": 3758,
      "turn_loss": 0.2547959089279175,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1746422598030106,
      "grad_norm": 0.525011420249939,
      "learning_rate": 7.859210982510927e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.008958745747804642,
      "mae_dx": 0.0022093949373811483,
      "mae_dy": 0.0019428025698289275,
      "pose_mae_dtheta": 0.06258887052536011,
      "pose_mae_dx": 0.02400047890841961,
      "pose_mae_dy": 0.026600459590554237,
      "pose_rmse_dtheta": 0.13576900959014893,
      "pose_rmse_dx": 0.06012291833758354,
      "pose_rmse_dy": 0.06279692053794861,
      "pose_rmse_mean": 0.08622962236404419,
      "rmse_dtheta": 0.01852034404873848,
      "rmse_dx": 0.006760886870324612,
      "rmse_dy": 0.00422952463850379,
      "rmse_mean": 0.009836919605731964,
      "rotation_flip": 0.0036883356515318155,
      "sparse_tokens": 32105.0,
      "step": 3759,
      "turn_loss": 0.0693255290389061,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.17468871956885337,
      "grad_norm": 0.4703584611415863,
      "learning_rate": 7.858126182051507e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.015166650526225567,
      "mae_dx": 0.004596587270498276,
      "mae_dy": 0.003354565240442753,
      "pose_mae_dtheta": 0.11185739189386368,
      "pose_mae_dx": 0.048915620893239975,
      "pose_mae_dy": 0.04731941968202591,
      "pose_rmse_dtheta": 0.24937286972999573,
      "pose_rmse_dx": 0.13901390135288239,
      "pose_rmse_dy": 0.12563742697238922,
      "pose_rmse_mean": 0.1713414043188095,
      "rmse_dtheta": 0.0289558507502079,
      "rmse_dx": 0.014093610458076,
      "rmse_dy": 0.007112919352948666,
      "rmse_mean": 0.016720794141292572,
      "rotation_flip": 0.008939455263316631,
      "sparse_tokens": 32073.0,
      "step": 3760,
      "turn_loss": 0.14532870054244995,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17473517933469615,
      "grad_norm": 0.31760165095329285,
      "learning_rate": 7.857041181721788e-06,
      "loss": 0.092,
      "mae_dtheta": 0.009837271645665169,
      "mae_dx": 0.0014615493128076196,
      "mae_dy": 0.001687738113105297,
      "pose_mae_dtheta": 0.06456135958433151,
      "pose_mae_dx": 0.016568321734666824,
      "pose_mae_dy": 0.02250562608242035,
      "pose_rmse_dtheta": 0.18435503542423248,
      "pose_rmse_dx": 0.044302552938461304,
      "pose_rmse_dy": 0.05957036837935448,
      "pose_rmse_mean": 0.09607598185539246,
      "rmse_dtheta": 0.023993227630853653,
      "rmse_dx": 0.005010851193219423,
      "rmse_dy": 0.0036800776142627,
      "rmse_mean": 0.010894718579947948,
      "rotation_flip": 0.004193848930299282,
      "sparse_tokens": 32089.0,
      "step": 3761,
      "turn_loss": 0.06607595086097717,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.17478163910053893,
      "grad_norm": 0.32780778408050537,
      "learning_rate": 7.855955981597644e-06,
      "loss": 0.0951,
      "mae_dtheta": 0.00788234081119299,
      "mae_dx": 0.0019985728431493044,
      "mae_dy": 0.0016092406585812569,
      "pose_mae_dtheta": 0.05790106952190399,
      "pose_mae_dx": 0.021635575219988823,
      "pose_mae_dy": 0.02104879729449749,
      "pose_rmse_dtheta": 0.16417858004570007,
      "pose_rmse_dx": 0.05357452854514122,
      "pose_rmse_dy": 0.05292263254523277,
      "pose_rmse_mean": 0.09022524952888489,
      "rmse_dtheta": 0.02009992115199566,
      "rmse_dx": 0.005872827488929033,
      "rmse_dy": 0.003653105115517974,
      "rmse_mean": 0.009875284507870674,
      "rotation_flip": 0.0037002775352448225,
      "sparse_tokens": 32121.0,
      "step": 3762,
      "turn_loss": 0.07248415797948837,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.1748280988663817,
      "grad_norm": 0.7574566602706909,
      "learning_rate": 7.854870581754967e-06,
      "loss": 0.1857,
      "mae_dtheta": 0.020769890397787094,
      "mae_dx": 0.00981336273252964,
      "mae_dy": 0.0052834791131317616,
      "pose_mae_dtheta": 0.195535346865654,
      "pose_mae_dx": 0.06903992593288422,
      "pose_mae_dy": 0.09923834353685379,
      "pose_rmse_dtheta": 0.3366856575012207,
      "pose_rmse_dx": 0.1474761813879013,
      "pose_rmse_dy": 0.20982679724693298,
      "pose_rmse_mean": 0.2313295602798462,
      "rmse_dtheta": 0.03439724072813988,
      "rmse_dx": 0.019565215334296227,
      "rmse_dy": 0.010236234404146671,
      "rmse_mean": 0.021399563178420067,
      "rotation_flip": 0.046875,
      "sparse_tokens": 1892.0,
      "step": 3763,
      "turn_loss": 0.23203036189079285,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.17487455863222448,
      "grad_norm": 0.7887206077575684,
      "learning_rate": 7.853784982269657e-06,
      "loss": 0.1616,
      "mae_dtheta": 0.03314846381545067,
      "mae_dx": 0.012792638503015041,
      "mae_dy": 0.0030322137754410505,
      "pose_mae_dtheta": 0.2503722906112671,
      "pose_mae_dx": 0.09399803727865219,
      "pose_mae_dy": 0.03942397981882095,
      "pose_rmse_dtheta": 0.48720690608024597,
      "pose_rmse_dx": 0.21634407341480255,
      "pose_rmse_dy": 0.10560400784015656,
      "pose_rmse_mean": 0.26971834897994995,
      "rmse_dtheta": 0.05529674515128136,
      "rmse_dx": 0.02537383697926998,
      "rmse_dy": 0.006733697839081287,
      "rmse_mean": 0.029134761542081833,
      "rotation_flip": 0.01976935751736164,
      "sparse_tokens": 9287.0,
      "step": 3764,
      "turn_loss": 0.23775045573711395,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 27255.0,
      "epoch": 0.17492101839806729,
      "grad_norm": 0.6700483560562134,
      "learning_rate": 7.852699183217632e-06,
      "loss": 0.1845,
      "mae_dtheta": 0.02985573187470436,
      "mae_dx": 0.012568342499434948,
      "mae_dy": 0.005492545198649168,
      "pose_mae_dtheta": 0.23039720952510834,
      "pose_mae_dx": 0.1129348874092102,
      "pose_mae_dy": 0.06668411195278168,
      "pose_rmse_dtheta": 0.41244226694107056,
      "pose_rmse_dx": 0.2620721459388733,
      "pose_rmse_dy": 0.15607990324497223,
      "pose_rmse_mean": 0.27686476707458496,
      "rmse_dtheta": 0.0465787872672081,
      "rmse_dx": 0.026331037282943726,
      "rmse_dy": 0.011101707816123962,
      "rmse_mean": 0.028003845363855362,
      "rotation_flip": 0.016286645084619522,
      "sparse_tokens": 20942.0,
      "step": 3765,
      "turn_loss": 0.2511111795902252,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.17496747816391006,
      "grad_norm": 0.49146273732185364,
      "learning_rate": 7.851613184674821e-06,
      "loss": 0.1547,
      "mae_dtheta": 0.03200965374708176,
      "mae_dx": 0.011168679222464561,
      "mae_dy": 0.00417549442499876,
      "pose_mae_dtheta": 0.2685945928096771,
      "pose_mae_dx": 0.0877285748720169,
      "pose_mae_dy": 0.04194534942507744,
      "pose_rmse_dtheta": 0.4609014689922333,
      "pose_rmse_dx": 0.20386111736297607,
      "pose_rmse_dy": 0.10650494694709778,
      "pose_rmse_mean": 0.25708919763565063,
      "rmse_dtheta": 0.04845825955271721,
      "rmse_dx": 0.022718576714396477,
      "rmse_dy": 0.0078970892354846,
      "rmse_mean": 0.026357974857091904,
      "rotation_flip": 0.016194332391023636,
      "sparse_tokens": 16223.0,
      "step": 3766,
      "turn_loss": 0.2939203977584839,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.17501393792975284,
      "grad_norm": 0.4754663407802582,
      "learning_rate": 7.85052698671717e-06,
      "loss": 0.1226,
      "mae_dtheta": 0.0071611483581364155,
      "mae_dx": 0.0017411864828318357,
      "mae_dy": 0.0019698673859238625,
      "pose_mae_dtheta": 0.04807301610708237,
      "pose_mae_dx": 0.021764343604445457,
      "pose_mae_dy": 0.02183101885020733,
      "pose_rmse_dtheta": 0.10263239592313766,
      "pose_rmse_dx": 0.0570845864713192,
      "pose_rmse_dy": 0.05682672932744026,
      "pose_rmse_mean": 0.07218123972415924,
      "rmse_dtheta": 0.01609654538333416,
      "rmse_dx": 0.004881931934505701,
      "rmse_dy": 0.005048438906669617,
      "rmse_mean": 0.00867563858628273,
      "rotation_flip": 0.007854687981307507,
      "sparse_tokens": 32105.0,
      "step": 3767,
      "turn_loss": 0.06998232007026672,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.17506039769559562,
      "grad_norm": 0.5676653385162354,
      "learning_rate": 7.849440589420639e-06,
      "loss": 0.1264,
      "mae_dtheta": 0.013112193904817104,
      "mae_dx": 0.0022906973026692867,
      "mae_dy": 0.0027968520298600197,
      "pose_mae_dtheta": 0.0910477340221405,
      "pose_mae_dx": 0.023243678733706474,
      "pose_mae_dy": 0.029483038932085037,
      "pose_rmse_dtheta": 0.22871997952461243,
      "pose_rmse_dx": 0.05809896066784859,
      "pose_rmse_dy": 0.06879503279924393,
      "pose_rmse_mean": 0.11853799223899841,
      "rmse_dtheta": 0.027693582698702812,
      "rmse_dx": 0.007132504601031542,
      "rmse_dy": 0.006701461970806122,
      "rmse_mean": 0.013842517510056496,
      "rotation_flip": 0.0073068891651928425,
      "sparse_tokens": 32153.0,
      "step": 3768,
      "turn_loss": 0.10301724821329117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1751068574614384,
      "grad_norm": 0.44834697246551514,
      "learning_rate": 7.848353992861195e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.012977740727365017,
      "mae_dx": 0.0017661479068920016,
      "mae_dy": 0.002999459160491824,
      "pose_mae_dtheta": 0.08818089216947556,
      "pose_mae_dx": 0.028934793546795845,
      "pose_mae_dy": 0.03771989047527313,
      "pose_rmse_dtheta": 0.19306445121765137,
      "pose_rmse_dx": 0.06659799069166183,
      "pose_rmse_dy": 0.08617113530635834,
      "pose_rmse_mean": 0.11527787148952484,
      "rmse_dtheta": 0.02520766481757164,
      "rmse_dx": 0.004997806623578072,
      "rmse_dy": 0.005590179935097694,
      "rmse_mean": 0.011931884102523327,
      "rotation_flip": 0.005070626735687256,
      "sparse_tokens": 32089.0,
      "step": 3769,
      "turn_loss": 0.09498340636491776,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.17515331722728117,
      "grad_norm": 0.5550150275230408,
      "learning_rate": 7.847267197114828e-06,
      "loss": 0.1087,
      "mae_dtheta": 0.02833612635731697,
      "mae_dx": 0.011521742679178715,
      "mae_dy": 0.005093629006296396,
      "pose_mae_dtheta": 0.1990499496459961,
      "pose_mae_dx": 0.08016286045312881,
      "pose_mae_dy": 0.06239788979291916,
      "pose_rmse_dtheta": 0.41665345430374146,
      "pose_rmse_dx": 0.18049310147762299,
      "pose_rmse_dy": 0.15614540874958038,
      "pose_rmse_mean": 0.25109732151031494,
      "rmse_dtheta": 0.046925731003284454,
      "rmse_dx": 0.023288313299417496,
      "rmse_dy": 0.011905028484761715,
      "rmse_mean": 0.027373027056455612,
      "rotation_flip": 0.00764818349853158,
      "sparse_tokens": 10237.0,
      "step": 3770,
      "turn_loss": 0.26990053057670593,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.17519977699312395,
      "grad_norm": 0.41233810782432556,
      "learning_rate": 7.846180202257539e-06,
      "loss": 0.0985,
      "mae_dtheta": 0.008966567926108837,
      "mae_dx": 0.0016229376196861267,
      "mae_dy": 0.0018100811867043376,
      "pose_mae_dtheta": 0.05430815741419792,
      "pose_mae_dx": 0.020047882571816444,
      "pose_mae_dy": 0.021237723529338837,
      "pose_rmse_dtheta": 0.12807118892669678,
      "pose_rmse_dx": 0.04378415644168854,
      "pose_rmse_dy": 0.048292554914951324,
      "pose_rmse_mean": 0.07338263839483261,
      "rmse_dtheta": 0.019689103588461876,
      "rmse_dx": 0.004361280240118504,
      "rmse_dy": 0.003776183817535639,
      "rmse_mean": 0.009275523014366627,
      "rotation_flip": 0.002352941082790494,
      "sparse_tokens": 32185.0,
      "step": 3771,
      "turn_loss": 0.0675177350640297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.17524623675896672,
      "grad_norm": 0.48033103346824646,
      "learning_rate": 7.84509300836534e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.012077114544808865,
      "mae_dx": 0.00211960356682539,
      "mae_dy": 0.0026808406691998243,
      "pose_mae_dtheta": 0.08996155858039856,
      "pose_mae_dx": 0.026330016553401947,
      "pose_mae_dy": 0.032367855310440063,
      "pose_rmse_dtheta": 0.21551144123077393,
      "pose_rmse_dx": 0.07130160927772522,
      "pose_rmse_dy": 0.0851769670844078,
      "pose_rmse_mean": 0.12399667501449585,
      "rmse_dtheta": 0.025780119001865387,
      "rmse_dx": 0.00629769079387188,
      "rmse_dy": 0.0072799851186573505,
      "rmse_mean": 0.01311926543712616,
      "rotation_flip": 0.004724409431219101,
      "sparse_tokens": 32121.0,
      "step": 3772,
      "turn_loss": 0.09320136159658432,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17529269652480953,
      "grad_norm": 0.3879287838935852,
      "learning_rate": 7.84400561551426e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.010502793826162815,
      "mae_dx": 0.0016453280113637447,
      "mae_dy": 0.0023352429270744324,
      "pose_mae_dtheta": 0.07386086881160736,
      "pose_mae_dx": 0.02138114906847477,
      "pose_mae_dy": 0.02726004458963871,
      "pose_rmse_dtheta": 0.20314183831214905,
      "pose_rmse_dx": 0.05746755003929138,
      "pose_rmse_dy": 0.06138577312231064,
      "pose_rmse_mean": 0.10733172297477722,
      "rmse_dtheta": 0.02308843657374382,
      "rmse_dx": 0.005496574100106955,
      "rmse_dy": 0.004868092481046915,
      "rmse_mean": 0.011151034384965897,
      "rotation_flip": 0.005767012480646372,
      "sparse_tokens": 32089.0,
      "step": 3773,
      "turn_loss": 0.07481323927640915,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.1753391562906523,
      "grad_norm": 0.5638880729675293,
      "learning_rate": 7.842918023780342e-06,
      "loss": 0.1512,
      "mae_dtheta": 0.032792672514915466,
      "mae_dx": 0.010451829060912132,
      "mae_dy": 0.003591638058423996,
      "pose_mae_dtheta": 0.26925474405288696,
      "pose_mae_dx": 0.07145275920629501,
      "pose_mae_dy": 0.03470304608345032,
      "pose_rmse_dtheta": 0.45182693004608154,
      "pose_rmse_dx": 0.1666450798511505,
      "pose_rmse_dy": 0.11978012323379517,
      "pose_rmse_mean": 0.2460840344429016,
      "rmse_dtheta": 0.04951193556189537,
      "rmse_dx": 0.022310307249426842,
      "rmse_dy": 0.01131980400532484,
      "rmse_mean": 0.027714014053344727,
      "rotation_flip": 0.0191256832331419,
      "sparse_tokens": 13234.0,
      "step": 3774,
      "turn_loss": 0.24124658107757568,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 38494.0,
      "epoch": 0.17538561605649508,
      "grad_norm": 0.7789003849029541,
      "learning_rate": 7.841830233239638e-06,
      "loss": 0.2765,
      "mae_dtheta": 0.03817586600780487,
      "mae_dx": 0.016713449731469154,
      "mae_dy": 0.0047966777347028255,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7789004445075989,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.6067352294922,
      "model/head/act_norm_mean": 109.3292574842437,
      "model/head/act_norm_min": 68.7950210571289,
      "model/head/act_over_embed": 75.13208929980723,
      "model/head/grad_frac": 0.10970824211835861,
      "model/head/grad_norm": 0.08545179665088654,
      "model/head/grad_zero_frac": 0.00014784865197725594,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6899619222689075,
      "model/head/update_ratio": 0.0014698136365041137,
      "model/head/weight_delta": 7.244925022125244,
      "model/head/weight_delta_rel": 0.12709744274616241,
      "model/head/weight_norm": 58.13784408569336,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41693058609962463,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41693058609962463,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41693058609962463,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28651860213330765,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12666596472263336,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0986601784825325,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.003196653677150607,
      "model/modality_embedder.encoders.pose/weight_delta": 2.373246192932129,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07754135131835938,
      "model/modality_embedder.encoders.pose/weight_norm": 30.86358070373535,
      "model/modality_embedder/grad_frac": 0.12666596472263336,
      "model/modality_embedder/grad_norm": 0.0986601784825325,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.003196653677150607,
      "model/modality_embedder/weight_delta": 2.373246192932129,
      "model/modality_embedder/weight_delta_rel": 0.07754135131835938,
      "model/modality_embedder/weight_norm": 30.86358070373535,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.6611328125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.44735810991063,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.154318809509277,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.113244010755768,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0782819464802742,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.060973845422267914,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002198493340983987,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.6760131120681763,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06107492744922638,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.734376907348633,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.46334075927734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.285564225690276,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.579320907592773,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.689267100928834,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08590294420719147,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06690984219312668,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002276579849421978,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.115325689315796,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07327653467655182,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.39051055908203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.53412628173828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.89051453914899,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.956100463867188,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.792203982119233,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09527084231376648,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07420650124549866,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002445813501253724,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.269442081451416,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0762036144733429,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.340213775634766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.43424987792969,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.81218945911698,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.097150802612305,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.112796978125285,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09450815618038177,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07361244410276413,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0024817788507789373,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.9361506700515747,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06616844236850739,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.661161422729492,
      "model/normalizer/grad_frac": 0.35152876377105713,
      "model/normalizer/grad_norm": 0.2738059163093567,
      "model/normalizer/grad_zero_frac": 0.00014299034955911338,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0034998981282114983,
      "model/normalizer/weight_delta": 4.117386341094971,
      "model/normalizer/weight_delta_rel": 0.05302955210208893,
      "model/normalizer/weight_norm": 78.23253631591797,
      "pose_mae_dtheta": 0.2970845401287079,
      "pose_mae_dx": 0.14436858892440796,
      "pose_mae_dy": 0.059705499559640884,
      "pose_rmse_dtheta": 0.521574079990387,
      "pose_rmse_dx": 0.2933029234409332,
      "pose_rmse_dy": 0.12309563905000687,
      "pose_rmse_mean": 0.31265756487846375,
      "rmse_dtheta": 0.056327175348997116,
      "rmse_dx": 0.029832854866981506,
      "rmse_dy": 0.008839713409543037,
      "rmse_mean": 0.0316665843129158,
      "rotation_flip": 0.009900989942252636,
      "sparse_tokens": 29794.0,
      "step": 3775,
      "turn_loss": 0.3178763687610626,
      "turns": 119.0,
      "turns_per_sample": 119.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.17543207582233786,
      "grad_norm": 0.5382964611053467,
      "learning_rate": 7.840742243968222e-06,
      "loss": 0.1206,
      "mae_dtheta": 0.034595441073179245,
      "mae_dx": 0.008895804174244404,
      "mae_dy": 0.00347829214297235,
      "pose_mae_dtheta": 0.2585999369621277,
      "pose_mae_dx": 0.044745951890945435,
      "pose_mae_dy": 0.02462594211101532,
      "pose_rmse_dtheta": 0.4693906903266907,
      "pose_rmse_dx": 0.1194147914648056,
      "pose_rmse_dy": 0.055772025138139725,
      "pose_rmse_mean": 0.21485917270183563,
      "rmse_dtheta": 0.05576445907354355,
      "rmse_dx": 0.02043079398572445,
      "rmse_dy": 0.007222962565720081,
      "rmse_mean": 0.027806073427200317,
      "rotation_flip": 0.011111111380159855,
      "sparse_tokens": 4697.0,
      "step": 3776,
      "turn_loss": 0.1922634392976761,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.17547853558818063,
      "grad_norm": 0.7805674076080322,
      "learning_rate": 7.839654056042176e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.03839196637272835,
      "mae_dx": 0.02015221118927002,
      "mae_dy": 0.00994542520493269,
      "pose_mae_dtheta": 0.3212326467037201,
      "pose_mae_dx": 0.17001307010650635,
      "pose_mae_dy": 0.12203628569841385,
      "pose_rmse_dtheta": 0.5513567924499512,
      "pose_rmse_dx": 0.32894039154052734,
      "pose_rmse_dy": 0.25351670384407043,
      "pose_rmse_mean": 0.3779379725456238,
      "rmse_dtheta": 0.05684242025017738,
      "rmse_dx": 0.033114977180957794,
      "rmse_dy": 0.019915135577321053,
      "rmse_mean": 0.036624178290367126,
      "rotation_flip": 0.017241379246115685,
      "sparse_tokens": 13955.0,
      "step": 3777,
      "turn_loss": 0.37518051266670227,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.1755249953540234,
      "grad_norm": 0.6259089708328247,
      "learning_rate": 7.838565669537599e-06,
      "loss": 0.1844,
      "mae_dtheta": 0.055818602442741394,
      "mae_dx": 0.010768669657409191,
      "mae_dy": 0.0033389488235116005,
      "pose_mae_dtheta": 0.48522821068763733,
      "pose_mae_dx": 0.0950184315443039,
      "pose_mae_dy": 0.04171469062566757,
      "pose_rmse_dtheta": 0.7663857936859131,
      "pose_rmse_dx": 0.21038614213466644,
      "pose_rmse_dy": 0.08755047619342804,
      "pose_rmse_mean": 0.3547741770744324,
      "rmse_dtheta": 0.07467993348836899,
      "rmse_dx": 0.021907998248934746,
      "rmse_dy": 0.007733733858913183,
      "rmse_mean": 0.03477388992905617,
      "rotation_flip": 0.019298246130347252,
      "sparse_tokens": 8794.0,
      "step": 3778,
      "turn_loss": 0.39421695470809937,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 33634.0,
      "epoch": 0.1755714551198662,
      "grad_norm": 0.5809735655784607,
      "learning_rate": 7.8374770845306e-06,
      "loss": 0.1533,
      "mae_dtheta": 0.04117584973573685,
      "mae_dx": 0.016477767378091812,
      "mae_dy": 0.006995540112257004,
      "pose_mae_dtheta": 0.310148686170578,
      "pose_mae_dx": 0.13148361444473267,
      "pose_mae_dy": 0.09011181443929672,
      "pose_rmse_dtheta": 0.49952244758605957,
      "pose_rmse_dx": 0.26465311646461487,
      "pose_rmse_dy": 0.19114114344120026,
      "pose_rmse_mean": 0.31843888759613037,
      "rmse_dtheta": 0.05714208260178566,
      "rmse_dx": 0.02945246733725071,
      "rmse_dy": 0.012086030095815659,
      "rmse_mean": 0.032893531024456024,
      "rotation_flip": 0.019777502864599228,
      "sparse_tokens": 25859.0,
      "step": 3779,
      "turn_loss": 0.3445574939250946,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.17561791488570896,
      "grad_norm": 0.6622581481933594,
      "learning_rate": 7.836388301097304e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.04917359724640846,
      "mae_dx": 0.010739266872406006,
      "mae_dy": 0.00412518298253417,
      "pose_mae_dtheta": 0.39185261726379395,
      "pose_mae_dx": 0.08612574636936188,
      "pose_mae_dy": 0.05515696853399277,
      "pose_rmse_dtheta": 0.6301530599594116,
      "pose_rmse_dx": 0.20820404589176178,
      "pose_rmse_dy": 0.11774612963199615,
      "pose_rmse_mean": 0.3187010884284973,
      "rmse_dtheta": 0.06478888541460037,
      "rmse_dx": 0.02089850604534149,
      "rmse_dy": 0.007580211386084557,
      "rmse_mean": 0.03108920156955719,
      "rotation_flip": 0.012145749293267727,
      "sparse_tokens": 4595.0,
      "step": 3780,
      "turn_loss": 0.34938904643058777,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.17566437465155177,
      "grad_norm": 0.48434820771217346,
      "learning_rate": 7.835299319313854e-06,
      "loss": 0.1107,
      "mae_dtheta": 0.042769379913806915,
      "mae_dx": 0.012812423519790173,
      "mae_dy": 0.0036628020461648703,
      "pose_mae_dtheta": 0.33728349208831787,
      "pose_mae_dx": 0.09376628696918488,
      "pose_mae_dy": 0.03994307294487953,
      "pose_rmse_dtheta": 0.6598813533782959,
      "pose_rmse_dx": 0.21249940991401672,
      "pose_rmse_dy": 0.1141839474439621,
      "pose_rmse_mean": 0.32885491847991943,
      "rmse_dtheta": 0.0675438791513443,
      "rmse_dx": 0.026392605155706406,
      "rmse_dy": 0.00644804397597909,
      "rmse_mean": 0.03346151113510132,
      "rotation_flip": 0.012903225608170033,
      "sparse_tokens": 2501.0,
      "step": 3781,
      "turn_loss": 0.3638070225715637,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17571083441739455,
      "grad_norm": 0.6329836249351501,
      "learning_rate": 7.8342101392564e-06,
      "loss": 0.172,
      "mae_dtheta": 0.012942584231495857,
      "mae_dx": 0.0023989819455891848,
      "mae_dy": 0.00300915096886456,
      "pose_mae_dtheta": 0.08757488429546356,
      "pose_mae_dx": 0.03245006501674652,
      "pose_mae_dy": 0.039182670414447784,
      "pose_rmse_dtheta": 0.15644389390945435,
      "pose_rmse_dx": 0.08011536300182343,
      "pose_rmse_dy": 0.08014331758022308,
      "pose_rmse_mean": 0.10556752979755402,
      "rmse_dtheta": 0.02278509922325611,
      "rmse_dx": 0.007549850735813379,
      "rmse_dy": 0.005435120314359665,
      "rmse_mean": 0.011923356913030148,
      "rotation_flip": 0.009507042355835438,
      "sparse_tokens": 32089.0,
      "step": 3782,
      "turn_loss": 0.10843069851398468,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.17575729418323732,
      "grad_norm": 0.5253431797027588,
      "learning_rate": 7.83312076100111e-06,
      "loss": 0.0883,
      "mae_dtheta": 0.0419156551361084,
      "mae_dx": 0.013176136650145054,
      "mae_dy": 0.005321508273482323,
      "pose_mae_dtheta": 0.3370540142059326,
      "pose_mae_dx": 0.11459368467330933,
      "pose_mae_dy": 0.06683764606714249,
      "pose_rmse_dtheta": 0.5721800923347473,
      "pose_rmse_dx": 0.24636782705783844,
      "pose_rmse_dy": 0.13966234028339386,
      "pose_rmse_mean": 0.31940340995788574,
      "rmse_dtheta": 0.05910685658454895,
      "rmse_dx": 0.025631288066506386,
      "rmse_dy": 0.009385679848492146,
      "rmse_mean": 0.03137461096048355,
      "rotation_flip": 0.013683009892702103,
      "sparse_tokens": 13680.0,
      "step": 3783,
      "turn_loss": 0.2814284563064575,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.1758037539490801,
      "grad_norm": 1.9361530542373657,
      "learning_rate": 7.832031184624165e-06,
      "loss": 0.3246,
      "mae_dtheta": 0.026420578360557556,
      "mae_dx": 0.004933874122798443,
      "mae_dy": 0.002210034755989909,
      "pose_mae_dtheta": 0.19385167956352234,
      "pose_mae_dx": 0.022233733907341957,
      "pose_mae_dy": 0.032744839787483215,
      "pose_rmse_dtheta": 0.4947154223918915,
      "pose_rmse_dx": 0.07015274465084076,
      "pose_rmse_dy": 0.11567229777574539,
      "pose_rmse_mean": 0.2268468141555786,
      "rmse_dtheta": 0.054376132786273956,
      "rmse_dx": 0.015324264764785767,
      "rmse_dy": 0.005533707328140736,
      "rmse_mean": 0.02507803589105606,
      "rotation_flip": 0.00913241971284151,
      "sparse_tokens": 4028.0,
      "step": 3784,
      "turn_loss": 0.09153596311807632,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 29849.0,
      "epoch": 0.17585021371492288,
      "grad_norm": 0.43399181962013245,
      "learning_rate": 7.830941410201758e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.030448218807578087,
      "mae_dx": 0.008617386221885681,
      "mae_dy": 0.005418867338448763,
      "pose_mae_dtheta": 0.23023808002471924,
      "pose_mae_dx": 0.07000688463449478,
      "pose_mae_dy": 0.060204047709703445,
      "pose_rmse_dtheta": 0.4030785858631134,
      "pose_rmse_dx": 0.1558903306722641,
      "pose_rmse_dy": 0.14477255940437317,
      "pose_rmse_mean": 0.23458048701286316,
      "rmse_dtheta": 0.04763723909854889,
      "rmse_dx": 0.018973765894770622,
      "rmse_dy": 0.010963388718664646,
      "rmse_mean": 0.025858132168650627,
      "rotation_flip": 0.021433355286717415,
      "sparse_tokens": 25080.0,
      "step": 3785,
      "turn_loss": 0.2692728638648987,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.17589667348076565,
      "grad_norm": 0.9910672903060913,
      "learning_rate": 7.829851437810099e-06,
      "loss": 0.2665,
      "mae_dtheta": 0.03577830642461777,
      "mae_dx": 0.012566080316901207,
      "mae_dy": 0.005432816222310066,
      "pose_mae_dtheta": 0.28210386633872986,
      "pose_mae_dx": 0.10285992920398712,
      "pose_mae_dy": 0.0901518315076828,
      "pose_rmse_dtheta": 0.5156823992729187,
      "pose_rmse_dx": 0.2357463240623474,
      "pose_rmse_dy": 0.19070866703987122,
      "pose_rmse_mean": 0.314045786857605,
      "rmse_dtheta": 0.05392768606543541,
      "rmse_dx": 0.026667647063732147,
      "rmse_dy": 0.008965342305600643,
      "rmse_mean": 0.02985355816781521,
      "rotation_flip": 0.008298755623400211,
      "sparse_tokens": 17877.0,
      "step": 3786,
      "turn_loss": 0.21798603236675262,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 29108.0,
      "epoch": 0.17594313324660843,
      "grad_norm": 0.6918836832046509,
      "learning_rate": 7.82876126752541e-06,
      "loss": 0.1796,
      "mae_dtheta": 0.036188963800668716,
      "mae_dx": 0.012822987511754036,
      "mae_dy": 0.00647188862785697,
      "pose_mae_dtheta": 0.30663296580314636,
      "pose_mae_dx": 0.10993611067533493,
      "pose_mae_dy": 0.07841644436120987,
      "pose_rmse_dtheta": 0.5259923338890076,
      "pose_rmse_dx": 0.24192386865615845,
      "pose_rmse_dy": 0.15159907937049866,
      "pose_rmse_mean": 0.30650508403778076,
      "rmse_dtheta": 0.05304352194070816,
      "rmse_dx": 0.026130149140954018,
      "rmse_dy": 0.012293433770537376,
      "rmse_mean": 0.030489034950733185,
      "rotation_flip": 0.017366135492920876,
      "sparse_tokens": 23506.0,
      "step": 3787,
      "turn_loss": 0.24497856199741364,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1759895930124512,
      "grad_norm": 0.5895262956619263,
      "learning_rate": 7.82767089942393e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.009290894493460655,
      "mae_dx": 0.0023845145478844643,
      "mae_dy": 0.002246440388262272,
      "pose_mae_dtheta": 0.06696634739637375,
      "pose_mae_dx": 0.026726141571998596,
      "pose_mae_dy": 0.030004560947418213,
      "pose_rmse_dtheta": 0.1475735306739807,
      "pose_rmse_dx": 0.06996320188045502,
      "pose_rmse_dy": 0.06971284747123718,
      "pose_rmse_mean": 0.0957498550415039,
      "rmse_dtheta": 0.02050628885626793,
      "rmse_dx": 0.0065836734138429165,
      "rmse_dy": 0.00503101572394371,
      "rmse_mean": 0.010706993751227856,
      "rotation_flip": 0.004959939047694206,
      "sparse_tokens": 32169.0,
      "step": 3788,
      "turn_loss": 0.0749255120754242,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.176036052778294,
      "grad_norm": 0.48481670022010803,
      "learning_rate": 7.826580333581904e-06,
      "loss": 0.1544,
      "mae_dtheta": 0.03486774489283562,
      "mae_dx": 0.012984199449419975,
      "mae_dy": 0.005747863557189703,
      "pose_mae_dtheta": 0.3158237040042877,
      "pose_mae_dx": 0.09881535917520523,
      "pose_mae_dy": 0.08194559067487717,
      "pose_rmse_dtheta": 0.5335788726806641,
      "pose_rmse_dx": 0.2381805181503296,
      "pose_rmse_dy": 0.1742483526468277,
      "pose_rmse_mean": 0.3153359293937683,
      "rmse_dtheta": 0.05336430296301842,
      "rmse_dx": 0.026250431314110756,
      "rmse_dy": 0.010600756853818893,
      "rmse_mean": 0.03007183037698269,
      "rotation_flip": 0.008368200622498989,
      "sparse_tokens": 7818.0,
      "step": 3789,
      "turn_loss": 0.22676877677440643,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1760825125441368,
      "grad_norm": 0.4589983820915222,
      "learning_rate": 7.825489570075598e-06,
      "loss": 0.1611,
      "mae_dtheta": 0.010364080779254436,
      "mae_dx": 0.0013611450558528304,
      "mae_dy": 0.0019023304339498281,
      "pose_mae_dtheta": 0.07616198062896729,
      "pose_mae_dx": 0.01934746652841568,
      "pose_mae_dy": 0.026705274358391762,
      "pose_rmse_dtheta": 0.19499216973781586,
      "pose_rmse_dx": 0.05665348470211029,
      "pose_rmse_dy": 0.07305685430765152,
      "pose_rmse_mean": 0.10823416709899902,
      "rmse_dtheta": 0.023011809214949608,
      "rmse_dx": 0.0040991404093801975,
      "rmse_dy": 0.004463616758584976,
      "rmse_mean": 0.010524855926632881,
      "rotation_flip": 0.004818221554160118,
      "sparse_tokens": 32073.0,
      "step": 3790,
      "turn_loss": 0.0779668465256691,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.17612897230997956,
      "grad_norm": 0.7621363997459412,
      "learning_rate": 7.82439860898129e-06,
      "loss": 0.2784,
      "mae_dtheta": 0.0398978516459465,
      "mae_dx": 0.01203177496790886,
      "mae_dy": 0.00402602506801486,
      "pose_mae_dtheta": 0.3374212384223938,
      "pose_mae_dx": 0.09365976601839066,
      "pose_mae_dy": 0.05761606618762016,
      "pose_rmse_dtheta": 0.5958964824676514,
      "pose_rmse_dx": 0.21659772098064423,
      "pose_rmse_dy": 0.14730414748191833,
      "pose_rmse_mean": 0.3199327886104584,
      "rmse_dtheta": 0.06033943593502045,
      "rmse_dx": 0.02502111718058586,
      "rmse_dy": 0.008469769731163979,
      "rmse_mean": 0.031276777386665344,
      "rotation_flip": 0.018607856705784798,
      "sparse_tokens": 26814.0,
      "step": 3791,
      "turn_loss": 0.2892340123653412,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.17617543207582234,
      "grad_norm": 0.6998852491378784,
      "learning_rate": 7.823307450375271e-06,
      "loss": 0.162,
      "mae_dtheta": 0.027324791997671127,
      "mae_dx": 0.018621571362018585,
      "mae_dy": 0.010293886996805668,
      "pose_mae_dtheta": 0.1875731199979782,
      "pose_mae_dx": 0.15954382717609406,
      "pose_mae_dy": 0.1310032159090042,
      "pose_rmse_dtheta": 0.2969329059123993,
      "pose_rmse_dx": 0.327266663312912,
      "pose_rmse_dy": 0.2996050715446472,
      "pose_rmse_mean": 0.30793488025665283,
      "rmse_dtheta": 0.03976307436823845,
      "rmse_dx": 0.03291526809334755,
      "rmse_dy": 0.020477406680583954,
      "rmse_mean": 0.031051917001605034,
      "rotation_flip": 0.014450866729021072,
      "sparse_tokens": 5602.0,
      "step": 3792,
      "turn_loss": 0.32765525579452515,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.17622189184166512,
      "grad_norm": 0.8050084710121155,
      "learning_rate": 7.822216094333847e-06,
      "loss": 0.241,
      "mae_dtheta": 0.026784725487232208,
      "mae_dx": 0.01318453997373581,
      "mae_dy": 0.0032508308067917824,
      "pose_mae_dtheta": 0.21526534855365753,
      "pose_mae_dx": 0.09727098047733307,
      "pose_mae_dy": 0.04787086322903633,
      "pose_rmse_dtheta": 0.421558678150177,
      "pose_rmse_dx": 0.22950562834739685,
      "pose_rmse_dy": 0.11837968975305557,
      "pose_rmse_mean": 0.2564813494682312,
      "rmse_dtheta": 0.04524852707982063,
      "rmse_dx": 0.026643436402082443,
      "rmse_dy": 0.0064514377154409885,
      "rmse_mean": 0.026114467531442642,
      "rotation_flip": 0.011454753577709198,
      "sparse_tokens": 16754.0,
      "step": 3793,
      "turn_loss": 0.2190835326910019,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1762683516075079,
      "grad_norm": 0.6463255286216736,
      "learning_rate": 7.821124540933337e-06,
      "loss": 0.0785,
      "mae_dtheta": 0.009236381389200687,
      "mae_dx": 0.0016563558019697666,
      "mae_dy": 0.0018126331269741058,
      "pose_mae_dtheta": 0.06304782629013062,
      "pose_mae_dx": 0.016065290197730064,
      "pose_mae_dy": 0.022399477660655975,
      "pose_rmse_dtheta": 0.17864355444908142,
      "pose_rmse_dx": 0.04261842742562294,
      "pose_rmse_dy": 0.05383050814270973,
      "pose_rmse_mean": 0.09169749915599823,
      "rmse_dtheta": 0.023251578211784363,
      "rmse_dx": 0.005294044967740774,
      "rmse_dy": 0.003829656168818474,
      "rmse_mean": 0.010791759938001633,
      "rotation_flip": 0.004359197802841663,
      "sparse_tokens": 32121.0,
      "step": 3794,
      "turn_loss": 0.06337843835353851,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.17631481137335067,
      "grad_norm": 0.39451029896736145,
      "learning_rate": 7.820032790250073e-06,
      "loss": 0.1094,
      "mae_dtheta": 0.008926929906010628,
      "mae_dx": 0.0024796754587441683,
      "mae_dy": 0.0015219838824123144,
      "pose_mae_dtheta": 0.06723465770483017,
      "pose_mae_dx": 0.02382057160139084,
      "pose_mae_dy": 0.023728586733341217,
      "pose_rmse_dtheta": 0.1913525015115738,
      "pose_rmse_dx": 0.06699485331773758,
      "pose_rmse_dy": 0.05679028853774071,
      "pose_rmse_mean": 0.10504588484764099,
      "rmse_dtheta": 0.021357493475079536,
      "rmse_dx": 0.008162599988281727,
      "rmse_dy": 0.002874621655791998,
      "rmse_mean": 0.010798238217830658,
      "rotation_flip": 0.002411091001704335,
      "sparse_tokens": 32057.0,
      "step": 3795,
      "turn_loss": 0.08440322428941727,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.17636127113919345,
      "grad_norm": 0.5337339639663696,
      "learning_rate": 7.818940842360404e-06,
      "loss": 0.155,
      "mae_dtheta": 0.010372103191912174,
      "mae_dx": 0.002437966177240014,
      "mae_dy": 0.002366183092817664,
      "pose_mae_dtheta": 0.0719628632068634,
      "pose_mae_dx": 0.022107355296611786,
      "pose_mae_dy": 0.022576654329895973,
      "pose_rmse_dtheta": 0.16757570207118988,
      "pose_rmse_dx": 0.0491192452609539,
      "pose_rmse_dy": 0.057484909892082214,
      "pose_rmse_mean": 0.09139329195022583,
      "rmse_dtheta": 0.02264547534286976,
      "rmse_dx": 0.007669278420507908,
      "rmse_dy": 0.007184308487921953,
      "rmse_mean": 0.012499688193202019,
      "rotation_flip": 0.003213138086721301,
      "sparse_tokens": 32169.0,
      "step": 3796,
      "turn_loss": 0.08752256631851196,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.17640773090503623,
      "grad_norm": 0.6131922602653503,
      "learning_rate": 7.817848697340687e-06,
      "loss": 0.1492,
      "mae_dtheta": 0.012209923006594181,
      "mae_dx": 0.0024596266448497772,
      "mae_dy": 0.0038678960409015417,
      "pose_mae_dtheta": 0.09736014902591705,
      "pose_mae_dx": 0.033603619784116745,
      "pose_mae_dy": 0.04631337523460388,
      "pose_rmse_dtheta": 0.28503552079200745,
      "pose_rmse_dx": 0.10557010024785995,
      "pose_rmse_dy": 0.13965459167957306,
      "pose_rmse_mean": 0.17675340175628662,
      "rmse_dtheta": 0.02973097749054432,
      "rmse_dx": 0.0070100934244692326,
      "rmse_dy": 0.01001241896301508,
      "rmse_mean": 0.015584496781229973,
      "rotation_flip": 0.008188825100660324,
      "sparse_tokens": 32057.0,
      "step": 3797,
      "turn_loss": 0.11153675615787506,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.17645419067087903,
      "grad_norm": 0.4811222553253174,
      "learning_rate": 7.816756355267298e-06,
      "loss": 0.1324,
      "mae_dtheta": 0.012294945307075977,
      "mae_dx": 0.0011977485846728086,
      "mae_dy": 0.002551538869738579,
      "pose_mae_dtheta": 0.09443290531635284,
      "pose_mae_dx": 0.018047261983156204,
      "pose_mae_dy": 0.03589343652129173,
      "pose_rmse_dtheta": 0.2617218792438507,
      "pose_rmse_dx": 0.04796554520726204,
      "pose_rmse_dy": 0.09157499670982361,
      "pose_rmse_mean": 0.13375414907932281,
      "rmse_dtheta": 0.02780228853225708,
      "rmse_dx": 0.0036181730683892965,
      "rmse_dy": 0.007318628020584583,
      "rmse_mean": 0.01291302964091301,
      "rotation_flip": 0.0031783869490027428,
      "sparse_tokens": 32073.0,
      "step": 3798,
      "turn_loss": 0.0897146537899971,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 39913.0,
      "epoch": 0.1765006504367218,
      "grad_norm": 0.5984339118003845,
      "learning_rate": 7.815663816216626e-06,
      "loss": 0.1933,
      "mae_dtheta": 0.03161531686782837,
      "mae_dx": 0.012849674560129642,
      "mae_dy": 0.004642948508262634,
      "pose_mae_dtheta": 0.2396276444196701,
      "pose_mae_dx": 0.10262411087751389,
      "pose_mae_dy": 0.05505905672907829,
      "pose_rmse_dtheta": 0.42447277903556824,
      "pose_rmse_dx": 0.22905758023262024,
      "pose_rmse_dy": 0.13152243196964264,
      "pose_rmse_mean": 0.26168426871299744,
      "rmse_dtheta": 0.049727655947208405,
      "rmse_dx": 0.02572958543896675,
      "rmse_dy": 0.010529213584959507,
      "rmse_mean": 0.028662152588367462,
      "rotation_flip": 0.00909090880304575,
      "sparse_tokens": 29839.0,
      "step": 3799,
      "turn_loss": 0.24991875886917114,
      "turns": 123.0,
      "turns_per_sample": 123.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.17654711020256458,
      "grad_norm": 0.6086679100990295,
      "learning_rate": 7.814571080265073e-06,
      "loss": 0.108,
      "mae_dtheta": 0.03438723459839821,
      "mae_dx": 0.012687836773693562,
      "mae_dy": 0.0031284387223422527,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6086679100990295,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 141.70262145996094,
      "model/head/act_norm_mean": 106.59519314236111,
      "model/head/act_norm_min": 65.51490020751953,
      "model/head/act_over_embed": 73.25321468735187,
      "model/head/grad_frac": 0.11536198854446411,
      "model/head/grad_norm": 0.07021714001893997,
      "model/head/grad_zero_frac": 0.00014975227531976998,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6855034722222222,
      "model/head/update_ratio": 0.0012076296843588352,
      "model/head/weight_delta": 7.275144100189209,
      "model/head/weight_delta_rel": 0.12762758135795593,
      "model/head/weight_norm": 58.144596099853516,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4170061945915222,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4170061945915222,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4170061945915222,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2865705609967975,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07284200936555862,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04433659464120865,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014365072129294276,
      "model/modality_embedder.encoders.pose/weight_delta": 2.3850603103637695,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0779273509979248,
      "model/modality_embedder.encoders.pose/weight_norm": 30.864164352416992,
      "model/modality_embedder/grad_frac": 0.07284200936555862,
      "model/modality_embedder/grad_norm": 0.04433659464120865,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0014365072129294276,
      "model/modality_embedder/weight_delta": 2.3850603103637695,
      "model/modality_embedder/weight_delta_rel": 0.0779273509979248,
      "model/modality_embedder/weight_norm": 30.864164352416992,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 68.25231170654297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.179621362433863,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.297417640686035,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.929252811298811,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11103202402591705,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06758163124322891,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0024366711732000113,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.684903621673584,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06139890477061272,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.7352294921875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 69.04266357421875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.039748677248678,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.453179359436035,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.520340354678343,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09482491761445999,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05771688371896744,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019636056385934353,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.1268796920776367,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07367677241563797,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.39331817626953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 70.69023132324219,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.68359237213404,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.831033706665039,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.650005131710707,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.1069192886352539,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06507834047079086,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002144717378541827,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.2810916900634766,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07659478485584259,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.343551635742188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 71.45903015136719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.54095568783069,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.864171028137207,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.926402591166774,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.14508429169654846,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08830815553665161,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 8.574080129619688e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0029770175460726023,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.9465978145599365,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06652547419071198,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.663297653198242,
      "model/normalizer/grad_frac": 0.5423586368560791,
      "model/normalizer/grad_norm": 0.33011630177497864,
      "model/normalizer/grad_zero_frac": 0.0001229007903020829,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004219512455165386,
      "model/normalizer/weight_delta": 4.139109134674072,
      "model/normalizer/weight_delta_rel": 0.053309328854084015,
      "model/normalizer/weight_norm": 78.23564910888672,
      "pose_mae_dtheta": 0.29099276661872864,
      "pose_mae_dx": 0.10025741159915924,
      "pose_mae_dy": 0.035618994385004044,
      "pose_rmse_dtheta": 0.5548118948936462,
      "pose_rmse_dx": 0.21345539391040802,
      "pose_rmse_dy": 0.07749681174755096,
      "pose_rmse_mean": 0.28192138671875,
      "rmse_dtheta": 0.055337268859148026,
      "rmse_dx": 0.02375274896621704,
      "rmse_dy": 0.005670316517353058,
      "rmse_mean": 0.02825344353914261,
      "rotation_flip": 0.008077544160187244,
      "sparse_tokens": 11560.0,
      "step": 3800,
      "turn_loss": 0.2872063219547272,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "epoch": 0.17654711020256458,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31730252504348755,
      "eval_objectnav_nopose_mae_dtheta": 0.040056150406599045,
      "eval_objectnav_nopose_mae_dx": 0.014053682796657085,
      "eval_objectnav_nopose_mae_dy": 0.004942746367305517,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3208405673503876,
      "eval_objectnav_nopose_pose_mae_dx": 0.11305170506238937,
      "eval_objectnav_nopose_pose_mae_dy": 0.05816945061087608,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5389721989631653,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24138732254505157,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13619807362556458,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3055191934108734,
      "eval_objectnav_nopose_rmse_dtheta": 0.05741564929485321,
      "eval_objectnav_nopose_rmse_dx": 0.0267076063901186,
      "eval_objectnav_nopose_rmse_dy": 0.009953704662621021,
      "eval_objectnav_nopose_rmse_mean": 0.0313589870929718,
      "eval_objectnav_nopose_rotation_flip": 0.013638469390571117,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31730252504348755,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 3800
    },
    {
      "epoch": 0.17654711020256458,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2890450954437256,
      "eval_objectnav_pose_mae_dtheta": 0.036741893738508224,
      "eval_objectnav_pose_mae_dx": 0.012491351924836636,
      "eval_objectnav_pose_mae_dy": 0.0045150574296712875,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2835988700389862,
      "eval_objectnav_pose_pose_mae_dx": 0.09978055953979492,
      "eval_objectnav_pose_pose_mae_dy": 0.050905492156744,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4867876470088959,
      "eval_objectnav_pose_pose_rmse_dx": 0.223677858710289,
      "eval_objectnav_pose_pose_rmse_dy": 0.12347976118326187,
      "eval_objectnav_pose_pose_rmse_mean": 0.2779817581176758,
      "eval_objectnav_pose_rmse_dtheta": 0.05430174618959427,
      "eval_objectnav_pose_rmse_dx": 0.025017987936735153,
      "eval_objectnav_pose_rmse_dy": 0.009393792599439621,
      "eval_objectnav_pose_rmse_mean": 0.029571175575256348,
      "eval_objectnav_pose_rotation_flip": 0.013582035899162292,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2890450954437256,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 3800
    },
    {
      "epoch": 0.17654711020256458,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10155776888132095,
      "eval_pointnav_mae_dtheta": 0.01161633525043726,
      "eval_pointnav_mae_dx": 0.002707274630665779,
      "eval_pointnav_mae_dy": 0.0026379732880741358,
      "eval_pointnav_pose_mae_dtheta": 0.08284779638051987,
      "eval_pointnav_pose_mae_dx": 0.030413659289479256,
      "eval_pointnav_pose_mae_dy": 0.029931653290987015,
      "eval_pointnav_pose_rmse_dtheta": 0.2260943502187729,
      "eval_pointnav_pose_rmse_dx": 0.08624930679798126,
      "eval_pointnav_pose_rmse_dy": 0.08354703336954117,
      "eval_pointnav_pose_rmse_mean": 0.1319635659456253,
      "eval_pointnav_rmse_dtheta": 0.02742820233106613,
      "eval_pointnav_rmse_dx": 0.008136873133480549,
      "eval_pointnav_rmse_dy": 0.006748204585164785,
      "eval_pointnav_rmse_mean": 0.01410442590713501,
      "eval_pointnav_rotation_flip": 0.004540459252893925,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10155776888132095,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 3800
    },
    {
      "epoch": 0.17654711020256458,
      "eval_loss": 0.2359684631228447,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31730252504348755,
      "eval_objectnav_nopose_mae_dtheta": 0.040056150406599045,
      "eval_objectnav_nopose_mae_dx": 0.014053682796657085,
      "eval_objectnav_nopose_mae_dy": 0.004942746367305517,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3208405673503876,
      "eval_objectnav_nopose_pose_mae_dx": 0.11305170506238937,
      "eval_objectnav_nopose_pose_mae_dy": 0.05816945061087608,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5389721989631653,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24138732254505157,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13619807362556458,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3055191934108734,
      "eval_objectnav_nopose_rmse_dtheta": 0.05741564929485321,
      "eval_objectnav_nopose_rmse_dx": 0.0267076063901186,
      "eval_objectnav_nopose_rmse_dy": 0.009953704662621021,
      "eval_objectnav_nopose_rmse_mean": 0.0313589870929718,
      "eval_objectnav_nopose_rotation_flip": 0.013638469390571117,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31730252504348755,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2890450954437256,
      "eval_objectnav_pose_mae_dtheta": 0.036741893738508224,
      "eval_objectnav_pose_mae_dx": 0.012491351924836636,
      "eval_objectnav_pose_mae_dy": 0.0045150574296712875,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2835988700389862,
      "eval_objectnav_pose_pose_mae_dx": 0.09978055953979492,
      "eval_objectnav_pose_pose_mae_dy": 0.050905492156744,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4867876470088959,
      "eval_objectnav_pose_pose_rmse_dx": 0.223677858710289,
      "eval_objectnav_pose_pose_rmse_dy": 0.12347976118326187,
      "eval_objectnav_pose_pose_rmse_mean": 0.2779817581176758,
      "eval_objectnav_pose_rmse_dtheta": 0.05430174618959427,
      "eval_objectnav_pose_rmse_dx": 0.025017987936735153,
      "eval_objectnav_pose_rmse_dy": 0.009393792599439621,
      "eval_objectnav_pose_rmse_mean": 0.029571175575256348,
      "eval_objectnav_pose_rotation_flip": 0.013582035899162292,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2890450954437256,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10155776888132095,
      "eval_pointnav_mae_dtheta": 0.01161633525043726,
      "eval_pointnav_mae_dx": 0.002707274630665779,
      "eval_pointnav_mae_dy": 0.0026379732880741358,
      "eval_pointnav_pose_mae_dtheta": 0.08284779638051987,
      "eval_pointnav_pose_mae_dx": 0.030413659289479256,
      "eval_pointnav_pose_mae_dy": 0.029931653290987015,
      "eval_pointnav_pose_rmse_dtheta": 0.2260943502187729,
      "eval_pointnav_pose_rmse_dx": 0.08624930679798126,
      "eval_pointnav_pose_rmse_dy": 0.08354703336954117,
      "eval_pointnav_pose_rmse_mean": 0.1319635659456253,
      "eval_pointnav_rmse_dtheta": 0.02742820233106613,
      "eval_pointnav_rmse_dx": 0.008136873133480549,
      "eval_pointnav_rmse_dy": 0.006748204585164785,
      "eval_pointnav_rmse_mean": 0.01410442590713501,
      "eval_pointnav_rotation_flip": 0.004540459252893925,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10155776888132095,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 3800
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.17659356996840736,
      "grad_norm": 0.6242802739143372,
      "learning_rate": 7.813478147489052e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.012521852739155293,
      "mae_dx": 0.0016489418921992183,
      "mae_dy": 0.0003058313741348684,
      "pose_mae_dtheta": 0.09080039709806442,
      "pose_mae_dx": 0.014898804016411304,
      "pose_mae_dy": 0.0050118290819227695,
      "pose_rmse_dtheta": 0.3387528359889984,
      "pose_rmse_dx": 0.035223010927438736,
      "pose_rmse_dy": 0.011776230297982693,
      "pose_rmse_mean": 0.12858402729034424,
      "rmse_dtheta": 0.03995278850197792,
      "rmse_dx": 0.004624154418706894,
      "rmse_dy": 0.0005576913827098906,
      "rmse_mean": 0.015044878236949444,
      "rotation_flip": 0.0011198208667337894,
      "sparse_tokens": 32233.0,
      "step": 3801,
      "turn_loss": 0.05851641669869423,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.17664002973425014,
      "grad_norm": 0.5372509956359863,
      "learning_rate": 7.812385017964993e-06,
      "loss": 0.1699,
      "mae_dtheta": 0.007258881349116564,
      "mae_dx": 0.002186145866289735,
      "mae_dy": 0.001659902511164546,
      "pose_mae_dtheta": 0.05280273035168648,
      "pose_mae_dx": 0.02264847792685032,
      "pose_mae_dy": 0.018716812133789062,
      "pose_rmse_dtheta": 0.14394421875476837,
      "pose_rmse_dx": 0.06031092628836632,
      "pose_rmse_dy": 0.05079258978366852,
      "pose_rmse_mean": 0.0850159153342247,
      "rmse_dtheta": 0.018694976344704628,
      "rmse_dx": 0.006258913781493902,
      "rmse_dy": 0.005114647094160318,
      "rmse_mean": 0.010022846050560474,
      "rotation_flip": 0.003619909519329667,
      "sparse_tokens": 32185.0,
      "step": 3802,
      "turn_loss": 0.06668663769960403,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1766864895000929,
      "grad_norm": 0.7149024605751038,
      "learning_rate": 7.811291691769343e-06,
      "loss": 0.1195,
      "mae_dtheta": 0.008803648874163628,
      "mae_dx": 0.0051810117438435555,
      "mae_dy": 0.0016676412196829915,
      "pose_mae_dtheta": 0.068234883248806,
      "pose_mae_dx": 0.04532221332192421,
      "pose_mae_dy": 0.026595380157232285,
      "pose_rmse_dtheta": 0.17726197838783264,
      "pose_rmse_dx": 0.1417139321565628,
      "pose_rmse_dy": 0.06607163697481155,
      "pose_rmse_mean": 0.1283491849899292,
      "rmse_dtheta": 0.021463444456458092,
      "rmse_dx": 0.01461104117333889,
      "rmse_dy": 0.003737178398296237,
      "rmse_mean": 0.013270555064082146,
      "rotation_flip": 0.007236842066049576,
      "sparse_tokens": 32057.0,
      "step": 3803,
      "turn_loss": 0.10216309130191803,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1767329492659357,
      "grad_norm": 0.5025913119316101,
      "learning_rate": 7.810198168978556e-06,
      "loss": 0.1158,
      "mae_dtheta": 0.013088280335068703,
      "mae_dx": 0.003706387709826231,
      "mae_dy": 0.0029642796143889427,
      "pose_mae_dtheta": 0.08518312126398087,
      "pose_mae_dx": 0.038493841886520386,
      "pose_mae_dy": 0.028417419642210007,
      "pose_rmse_dtheta": 0.2210361212491989,
      "pose_rmse_dx": 0.09689215570688248,
      "pose_rmse_dy": 0.059726107865571976,
      "pose_rmse_mean": 0.1258848011493683,
      "rmse_dtheta": 0.02779669128358364,
      "rmse_dx": 0.010713133029639721,
      "rmse_dy": 0.006631466094404459,
      "rmse_mean": 0.015047097578644753,
      "rotation_flip": 0.004299534019082785,
      "sparse_tokens": 32137.0,
      "step": 3804,
      "turn_loss": 0.14247065782546997,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.17677940903177847,
      "grad_norm": 0.5955897569656372,
      "learning_rate": 7.8091044496691e-06,
      "loss": 0.1687,
      "mae_dtheta": 0.033961448818445206,
      "mae_dx": 0.02231655642390251,
      "mae_dy": 0.005926324520260096,
      "pose_mae_dtheta": 0.29618942737579346,
      "pose_mae_dx": 0.17100606858730316,
      "pose_mae_dy": 0.0558551624417305,
      "pose_rmse_dtheta": 0.45733317732810974,
      "pose_rmse_dx": 0.31236279010772705,
      "pose_rmse_dy": 0.10892017930746078,
      "pose_rmse_mean": 0.2928720712661743,
      "rmse_dtheta": 0.047732073813676834,
      "rmse_dx": 0.03497372940182686,
      "rmse_dy": 0.011170643381774426,
      "rmse_mean": 0.0312921479344368,
      "rotation_flip": 0.015810277312994003,
      "sparse_tokens": 4101.0,
      "step": 3805,
      "turn_loss": 0.40210938453674316,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.17682586879762127,
      "grad_norm": 0.4243413805961609,
      "learning_rate": 7.808010533917465e-06,
      "loss": 0.1397,
      "mae_dtheta": 0.011751593090593815,
      "mae_dx": 0.002664947183802724,
      "mae_dy": 0.003685589414089918,
      "pose_mae_dtheta": 0.07720712572336197,
      "pose_mae_dx": 0.035569388419389725,
      "pose_mae_dy": 0.03642108291387558,
      "pose_rmse_dtheta": 0.16119973361492157,
      "pose_rmse_dx": 0.09206902235746384,
      "pose_rmse_dy": 0.0738586038351059,
      "pose_rmse_mean": 0.1090424507856369,
      "rmse_dtheta": 0.022201811894774437,
      "rmse_dx": 0.007277644705027342,
      "rmse_dy": 0.008001482114195824,
      "rmse_mean": 0.012493646703660488,
      "rotation_flip": 0.003924366552382708,
      "sparse_tokens": 32057.0,
      "step": 3806,
      "turn_loss": 0.10745947062969208,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.17687232856346405,
      "grad_norm": 0.7173925042152405,
      "learning_rate": 7.806916421800146e-06,
      "loss": 0.1037,
      "mae_dtheta": 0.0423666313290596,
      "mae_dx": 0.004038334358483553,
      "mae_dy": 0.0029570148326456547,
      "pose_mae_dtheta": 0.3247884511947632,
      "pose_mae_dx": 0.04453543201088905,
      "pose_mae_dy": 0.048086170107126236,
      "pose_rmse_dtheta": 0.5582124590873718,
      "pose_rmse_dx": 0.10987802594900131,
      "pose_rmse_dy": 0.12230867147445679,
      "pose_rmse_mean": 0.26346638798713684,
      "rmse_dtheta": 0.06392046064138412,
      "rmse_dx": 0.009478652849793434,
      "rmse_dy": 0.006685218773782253,
      "rmse_mean": 0.026694778352975845,
      "rotation_flip": 0.00913241971284151,
      "sparse_tokens": 4170.0,
      "step": 3807,
      "turn_loss": 0.25122299790382385,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.17691878832930683,
      "grad_norm": 0.5967103242874146,
      "learning_rate": 7.805822113393653e-06,
      "loss": 0.1218,
      "mae_dtheta": 0.012358471751213074,
      "mae_dx": 0.0027153792325407267,
      "mae_dy": 0.0030890333000570536,
      "pose_mae_dtheta": 0.07864192873239517,
      "pose_mae_dx": 0.03302310034632683,
      "pose_mae_dy": 0.033662691712379456,
      "pose_rmse_dtheta": 0.19410723447799683,
      "pose_rmse_dx": 0.06993349641561508,
      "pose_rmse_dy": 0.07704371958971024,
      "pose_rmse_mean": 0.11369481682777405,
      "rmse_dtheta": 0.024261480197310448,
      "rmse_dx": 0.00767292408272624,
      "rmse_dy": 0.005913783796131611,
      "rmse_mean": 0.01261606253683567,
      "rotation_flip": 0.004659498110413551,
      "sparse_tokens": 32105.0,
      "step": 3808,
      "turn_loss": 0.09639453142881393,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.1769652480951496,
      "grad_norm": 0.6084556579589844,
      "learning_rate": 7.804727608774516e-06,
      "loss": 0.1446,
      "mae_dtheta": 0.046838440001010895,
      "mae_dx": 0.011114563792943954,
      "mae_dy": 0.0058310367166996,
      "pose_mae_dtheta": 0.3907862901687622,
      "pose_mae_dx": 0.08750886470079422,
      "pose_mae_dy": 0.06853824853897095,
      "pose_rmse_dtheta": 0.6481521129608154,
      "pose_rmse_dx": 0.21607862412929535,
      "pose_rmse_dy": 0.16670304536819458,
      "pose_rmse_mean": 0.3436446189880371,
      "rmse_dtheta": 0.06632396578788757,
      "rmse_dx": 0.023140093311667442,
      "rmse_dy": 0.01419912464916706,
      "rmse_mean": 0.03455439582467079,
      "rotation_flip": 0.01032448373734951,
      "sparse_tokens": 10224.0,
      "step": 3809,
      "turn_loss": 0.3408964276313782,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.17701170786099238,
      "grad_norm": 0.48275572061538696,
      "learning_rate": 7.80363290801927e-06,
      "loss": 0.0931,
      "mae_dtheta": 0.011374633759260178,
      "mae_dx": 0.001702250330708921,
      "mae_dy": 0.002526253694668412,
      "pose_mae_dtheta": 0.07764747738838196,
      "pose_mae_dx": 0.024723701179027557,
      "pose_mae_dy": 0.03307753801345825,
      "pose_rmse_dtheta": 0.15480798482894897,
      "pose_rmse_dx": 0.059986576437950134,
      "pose_rmse_dy": 0.0733855813741684,
      "pose_rmse_mean": 0.09606005251407623,
      "rmse_dtheta": 0.021153666079044342,
      "rmse_dx": 0.004504009149968624,
      "rmse_dy": 0.005107506178319454,
      "rmse_mean": 0.010255061089992523,
      "rotation_flip": 0.005910987500101328,
      "sparse_tokens": 32121.0,
      "step": 3810,
      "turn_loss": 0.08309880644083023,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.17705816762683516,
      "grad_norm": 0.3330920934677124,
      "learning_rate": 7.80253801120447e-06,
      "loss": 0.0959,
      "mae_dtheta": 0.013923410326242447,
      "mae_dx": 0.0018690734868869185,
      "mae_dy": 0.0036428491584956646,
      "pose_mae_dtheta": 0.09218482673168182,
      "pose_mae_dx": 0.031191155314445496,
      "pose_mae_dy": 0.04467151314020157,
      "pose_rmse_dtheta": 0.2019333839416504,
      "pose_rmse_dx": 0.07129952311515808,
      "pose_rmse_dy": 0.08753062039613724,
      "pose_rmse_mean": 0.1202545091509819,
      "rmse_dtheta": 0.02618691883981228,
      "rmse_dx": 0.005369389429688454,
      "rmse_dy": 0.006503286771476269,
      "rmse_mean": 0.012686531990766525,
      "rotation_flip": 0.004789599683135748,
      "sparse_tokens": 32057.0,
      "step": 3811,
      "turn_loss": 0.1082078367471695,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.17710462739267793,
      "grad_norm": 0.8942322134971619,
      "learning_rate": 7.801442918406684e-06,
      "loss": 0.2775,
      "mae_dtheta": 0.03932899236679077,
      "mae_dx": 0.011162173934280872,
      "mae_dy": 0.0038047898560762405,
      "pose_mae_dtheta": 0.346004843711853,
      "pose_mae_dx": 0.10178957879543304,
      "pose_mae_dy": 0.0571780800819397,
      "pose_rmse_dtheta": 0.6004204750061035,
      "pose_rmse_dx": 0.23293587565422058,
      "pose_rmse_dy": 0.16923551261425018,
      "pose_rmse_mean": 0.3341972827911377,
      "rmse_dtheta": 0.06161753088235855,
      "rmse_dx": 0.023400796577334404,
      "rmse_dy": 0.011629456654191017,
      "rmse_mean": 0.03221593052148819,
      "rotation_flip": 0.020987654104828835,
      "sparse_tokens": 13436.0,
      "step": 3812,
      "turn_loss": 0.2722490727901459,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.1771510871585207,
      "grad_norm": 0.803076982498169,
      "learning_rate": 7.800347629702491e-06,
      "loss": 0.2949,
      "mae_dtheta": 0.04611411690711975,
      "mae_dx": 0.009193739853799343,
      "mae_dy": 0.0031404143664985895,
      "pose_mae_dtheta": 0.394565612077713,
      "pose_mae_dx": 0.07033079862594604,
      "pose_mae_dy": 0.03443782404065132,
      "pose_rmse_dtheta": 0.640173614025116,
      "pose_rmse_dx": 0.17297084629535675,
      "pose_rmse_dy": 0.11094548553228378,
      "pose_rmse_mean": 0.30802997946739197,
      "rmse_dtheta": 0.0667686015367508,
      "rmse_dx": 0.020441388711333275,
      "rmse_dy": 0.008354301564395428,
      "rmse_mean": 0.03185476362705231,
      "rotation_flip": 0.010440835729241371,
      "sparse_tokens": 25568.0,
      "step": 3813,
      "turn_loss": 0.3342396914958954,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1771975469243635,
      "grad_norm": 0.6388502717018127,
      "learning_rate": 7.799252145168485e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.009349989704787731,
      "mae_dx": 0.0027021830901503563,
      "mae_dy": 0.002599984174594283,
      "pose_mae_dtheta": 0.06501048058271408,
      "pose_mae_dx": 0.03412415087223053,
      "pose_mae_dy": 0.024628281593322754,
      "pose_rmse_dtheta": 0.16381600499153137,
      "pose_rmse_dx": 0.08831685036420822,
      "pose_rmse_dy": 0.061095207929611206,
      "pose_rmse_mean": 0.104409359395504,
      "rmse_dtheta": 0.021752476692199707,
      "rmse_dx": 0.007418581284582615,
      "rmse_dy": 0.006230431608855724,
      "rmse_mean": 0.011800496838986874,
      "rotation_flip": 0.002661934355273843,
      "sparse_tokens": 32089.0,
      "step": 3814,
      "turn_loss": 0.09061314165592194,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1772440066902063,
      "grad_norm": 0.6682756543159485,
      "learning_rate": 7.798156464881272e-06,
      "loss": 0.1621,
      "mae_dtheta": 0.012791875749826431,
      "mae_dx": 0.002736159134656191,
      "mae_dy": 0.004971092101186514,
      "pose_mae_dtheta": 0.08973913639783859,
      "pose_mae_dx": 0.04235819727182388,
      "pose_mae_dy": 0.050492532551288605,
      "pose_rmse_dtheta": 0.18474696576595306,
      "pose_rmse_dx": 0.12068887799978256,
      "pose_rmse_dy": 0.11951293796300888,
      "pose_rmse_mean": 0.14164960384368896,
      "rmse_dtheta": 0.02374369464814663,
      "rmse_dx": 0.0072938972152769566,
      "rmse_dy": 0.010756325908005238,
      "rmse_mean": 0.013931306079030037,
      "rotation_flip": 0.0046635577455163,
      "sparse_tokens": 32073.0,
      "step": 3815,
      "turn_loss": 0.1170618012547493,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.17729046645604907,
      "grad_norm": 0.33785590529441833,
      "learning_rate": 7.797060588917477e-06,
      "loss": 0.0682,
      "mae_dtheta": 0.007883693091571331,
      "mae_dx": 0.0014314422151073813,
      "mae_dy": 0.0019947004038840532,
      "pose_mae_dtheta": 0.05512310937047005,
      "pose_mae_dx": 0.02202540822327137,
      "pose_mae_dy": 0.02553439326584339,
      "pose_rmse_dtheta": 0.1111430749297142,
      "pose_rmse_dx": 0.05326099321246147,
      "pose_rmse_dy": 0.05422642081975937,
      "pose_rmse_mean": 0.07287683337926865,
      "rmse_dtheta": 0.01654658652842045,
      "rmse_dx": 0.0037038482259958982,
      "rmse_dy": 0.004352238029241562,
      "rmse_mean": 0.008200891315937042,
      "rotation_flip": 0.0020859406795352697,
      "sparse_tokens": 32073.0,
      "step": 3816,
      "turn_loss": 0.06328417360782623,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.17733692622189184,
      "grad_norm": 0.6010681390762329,
      "learning_rate": 7.795964517353734e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.009671539068222046,
      "mae_dx": 0.002103831386193633,
      "mae_dy": 0.001359289512038231,
      "pose_mae_dtheta": 0.06775235384702682,
      "pose_mae_dx": 0.017067233100533485,
      "pose_mae_dy": 0.01700788177549839,
      "pose_rmse_dtheta": 0.2026275396347046,
      "pose_rmse_dx": 0.042552318423986435,
      "pose_rmse_dy": 0.06719553470611572,
      "pose_rmse_mean": 0.10412513464689255,
      "rmse_dtheta": 0.02660122700035572,
      "rmse_dx": 0.006111263297498226,
      "rmse_dy": 0.0038656406104564667,
      "rmse_mean": 0.012192710302770138,
      "rotation_flip": 0.005323505494743586,
      "sparse_tokens": 32233.0,
      "step": 3817,
      "turn_loss": 0.07882223278284073,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.17738338598773462,
      "grad_norm": 0.46950632333755493,
      "learning_rate": 7.794868250266692e-06,
      "loss": 0.1221,
      "mae_dtheta": 0.03171590715646744,
      "mae_dx": 0.008762707002460957,
      "mae_dy": 0.004449994768947363,
      "pose_mae_dtheta": 0.251327782869339,
      "pose_mae_dx": 0.06584274768829346,
      "pose_mae_dy": 0.06340654194355011,
      "pose_rmse_dtheta": 0.4701176583766937,
      "pose_rmse_dx": 0.15985332429409027,
      "pose_rmse_dy": 0.14303046464920044,
      "pose_rmse_mean": 0.2576671540737152,
      "rmse_dtheta": 0.05011868104338646,
      "rmse_dx": 0.020271003246307373,
      "rmse_dy": 0.00871801096946001,
      "rmse_mean": 0.026369234547019005,
      "rotation_flip": 0.002200220013037324,
      "sparse_tokens": 17393.0,
      "step": 3818,
      "turn_loss": 0.24157468974590302,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.1774298457535774,
      "grad_norm": 0.8200180530548096,
      "learning_rate": 7.793771787733013e-06,
      "loss": 0.1796,
      "mae_dtheta": 0.03459285572171211,
      "mae_dx": 0.00759692071005702,
      "mae_dy": 0.005950997583568096,
      "pose_mae_dtheta": 0.30372172594070435,
      "pose_mae_dx": 0.05974298715591431,
      "pose_mae_dy": 0.0640416219830513,
      "pose_rmse_dtheta": 0.5611425042152405,
      "pose_rmse_dx": 0.15493352711200714,
      "pose_rmse_dy": 0.13286182284355164,
      "pose_rmse_mean": 0.2829793095588684,
      "rmse_dtheta": 0.054561953991651535,
      "rmse_dx": 0.019695773720741272,
      "rmse_dy": 0.011355272494256496,
      "rmse_mean": 0.02853766828775406,
      "rotation_flip": 0.01005025114864111,
      "sparse_tokens": 6673.0,
      "step": 3819,
      "turn_loss": 0.1960049420595169,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.17747630551942017,
      "grad_norm": 0.8008849024772644,
      "learning_rate": 7.792675129829374e-06,
      "loss": 0.1792,
      "mae_dtheta": 0.013057912699878216,
      "mae_dx": 0.00289681158028543,
      "mae_dy": 0.0017343721119686961,
      "pose_mae_dtheta": 0.09920400381088257,
      "pose_mae_dx": 0.02754674106836319,
      "pose_mae_dy": 0.021310880780220032,
      "pose_rmse_dtheta": 0.2783326208591461,
      "pose_rmse_dx": 0.07175144553184509,
      "pose_rmse_dy": 0.056179653853178024,
      "pose_rmse_mean": 0.1354212462902069,
      "rmse_dtheta": 0.031399406492710114,
      "rmse_dx": 0.008275361731648445,
      "rmse_dy": 0.00438315887004137,
      "rmse_mean": 0.014685975387692451,
      "rotation_flip": 0.004491018131375313,
      "sparse_tokens": 32153.0,
      "step": 3820,
      "turn_loss": 0.10413490980863571,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.17752276528526295,
      "grad_norm": 0.5886452198028564,
      "learning_rate": 7.791578276632461e-06,
      "loss": 0.082,
      "mae_dtheta": 0.011094599962234497,
      "mae_dx": 0.0018107345094904304,
      "mae_dy": 0.001874792156741023,
      "pose_mae_dtheta": 0.07546129077672958,
      "pose_mae_dx": 0.020521149039268494,
      "pose_mae_dy": 0.02180945686995983,
      "pose_rmse_dtheta": 0.20555582642555237,
      "pose_rmse_dx": 0.044662319123744965,
      "pose_rmse_dy": 0.06532209366559982,
      "pose_rmse_mean": 0.10518008470535278,
      "rmse_dtheta": 0.02696126326918602,
      "rmse_dx": 0.004592226818203926,
      "rmse_dy": 0.0041360873728990555,
      "rmse_mean": 0.01189652644097805,
      "rotation_flip": 0.003960396163165569,
      "sparse_tokens": 32233.0,
      "step": 3821,
      "turn_loss": 0.08275400102138519,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.17756922505110576,
      "grad_norm": 0.526658296585083,
      "learning_rate": 7.790481228218985e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.008889195509254932,
      "mae_dx": 0.0016897764289751649,
      "mae_dy": 0.0005740229389630258,
      "pose_mae_dtheta": 0.06427240371704102,
      "pose_mae_dx": 0.01251955796033144,
      "pose_mae_dy": 0.006303388625383377,
      "pose_rmse_dtheta": 0.24068886041641235,
      "pose_rmse_dx": 0.031247373670339584,
      "pose_rmse_dy": 0.018079973757267,
      "pose_rmse_mean": 0.09667207300662994,
      "rmse_dtheta": 0.030145514756441116,
      "rmse_dx": 0.00477567408233881,
      "rmse_dy": 0.002352949231863022,
      "rmse_mean": 0.012424713000655174,
      "rotation_flip": 0.0022308980114758015,
      "sparse_tokens": 32201.0,
      "step": 3822,
      "turn_loss": 0.04883439466357231,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.17761568481694853,
      "grad_norm": 0.7206566333770752,
      "learning_rate": 7.789383984665658e-06,
      "loss": 0.1138,
      "mae_dtheta": 0.007923712022602558,
      "mae_dx": 0.0021482224110513926,
      "mae_dy": 0.0006219492643140256,
      "pose_mae_dtheta": 0.05931466445326805,
      "pose_mae_dx": 0.020336654037237167,
      "pose_mae_dy": 0.010127253830432892,
      "pose_rmse_dtheta": 0.21621617674827576,
      "pose_rmse_dx": 0.04684627801179886,
      "pose_rmse_dy": 0.027944032102823257,
      "pose_rmse_mean": 0.09700216352939606,
      "rmse_dtheta": 0.02496686950325966,
      "rmse_dx": 0.0058207944966852665,
      "rmse_dy": 0.0013458654284477234,
      "rmse_mean": 0.010711176320910454,
      "rotation_flip": 0.0022573363967239857,
      "sparse_tokens": 32233.0,
      "step": 3823,
      "turn_loss": 0.05773066356778145,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1776621445827913,
      "grad_norm": 0.5333976149559021,
      "learning_rate": 7.78828654604921e-06,
      "loss": 0.0966,
      "mae_dtheta": 0.008408614434301853,
      "mae_dx": 0.002327672438696027,
      "mae_dy": 0.000951408117543906,
      "pose_mae_dtheta": 0.06156699359416962,
      "pose_mae_dx": 0.02143850550055504,
      "pose_mae_dy": 0.012086545117199421,
      "pose_rmse_dtheta": 0.22342407703399658,
      "pose_rmse_dx": 0.0583166778087616,
      "pose_rmse_dy": 0.032171472907066345,
      "pose_rmse_mean": 0.10463740676641464,
      "rmse_dtheta": 0.0250714011490345,
      "rmse_dx": 0.006630866788327694,
      "rmse_dy": 0.0021978961303830147,
      "rmse_mean": 0.01130005531013012,
      "rotation_flip": 0.0020565553568303585,
      "sparse_tokens": 32169.0,
      "step": 3824,
      "turn_loss": 0.05875808000564575,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.17770860434863409,
      "grad_norm": 0.5936954617500305,
      "learning_rate": 7.787188912446389e-06,
      "loss": 0.1239,
      "mae_dtheta": 0.007222344167530537,
      "mae_dx": 0.0018607296515256166,
      "mae_dy": 0.00036242729402147233,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5936955213546753,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 167.55445861816406,
      "model/head/act_norm_mean": 134.94606218434345,
      "model/head/act_norm_min": 75.26461791992188,
      "model/head/act_over_embed": 92.73619731801995,
      "model/head/grad_frac": 0.089236319065094,
      "model/head/grad_norm": 0.052979204803705215,
      "model/head/grad_zero_frac": 0.000163394957780838,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6801905776515151,
      "model/head/update_ratio": 0.0009110727114602923,
      "model/head/weight_delta": 7.301835060119629,
      "model/head/weight_delta_rel": 0.1280958205461502,
      "model/head/weight_norm": 58.150360107421875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41721197962760925,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41714094446060507,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41706758737564087,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2866631623683794,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10209295898675919,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06061213091015816,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5382563164893617,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019636957440525293,
      "model/modality_embedder.encoders.pose/weight_delta": 2.393826723098755,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07821378111839294,
      "model/modality_embedder.encoders.pose/weight_norm": 30.86635398864746,
      "model/modality_embedder/grad_frac": 0.10209295898675919,
      "model/modality_embedder/grad_norm": 0.06061213091015816,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5382563164893617,
      "model/modality_embedder/update_ratio": 0.0019636957440525293,
      "model/modality_embedder/weight_delta": 2.393826723098755,
      "model/modality_embedder/weight_delta_rel": 0.07821378111839294,
      "model/modality_embedder/weight_norm": 30.86635398864746,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.35269165039062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 26.016306417348083,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.022965431213379,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.878649338499766,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.062406718730926514,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03705058991909027,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013357822317630053,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.6934025287628174,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.061708610504865646,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.736997604370117,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.73087310791016,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 27.11342091550425,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.338579177856445,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.632596692980442,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.067694291472435,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.040189798921346664,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013671389315277338,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.138232707977295,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0740700513124466,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.39701271057129,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.43010711669922,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 29.02820115840949,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.428726196289062,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.948451602359995,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07235448062419891,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.042956531047821045,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001415531150996685,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.2923731803894043,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07697360217571259,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.346580505371094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.2873764038086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 30.785165644540644,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.819372177124023,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 21.15585404619,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0772799625992775,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.045880768448114395,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015466262120753527,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.956719160079956,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06687137484550476,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.66506576538086,
      "model/normalizer/grad_frac": 0.2506301999092102,
      "model/normalizer/grad_norm": 0.14879801869392395,
      "model/normalizer/grad_zero_frac": 0.0001902598887681961,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0019018392777070403,
      "model/normalizer/weight_delta": 4.160299301147461,
      "model/normalizer/weight_delta_rel": 0.05358224734663963,
      "model/normalizer/weight_norm": 78.23900604248047,
      "pose_mae_dtheta": 0.05253168195486069,
      "pose_mae_dx": 0.01555084902793169,
      "pose_mae_dy": 0.005638059228658676,
      "pose_rmse_dtheta": 0.22422665357589722,
      "pose_rmse_dx": 0.037981245666742325,
      "pose_rmse_dy": 0.015232514590024948,
      "pose_rmse_mean": 0.0924801379442215,
      "rmse_dtheta": 0.027123350650072098,
      "rmse_dx": 0.005334692541509867,
      "rmse_dy": 0.0008109495975077152,
      "rmse_mean": 0.011089665815234184,
      "rotation_flip": 0.003508772002533078,
      "sparse_tokens": 32201.0,
      "step": 3825,
      "turn_loss": 0.04009674862027168,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.17775506411447686,
      "grad_norm": 0.6639281511306763,
      "learning_rate": 7.78609108393395e-06,
      "loss": 0.1704,
      "mae_dtheta": 0.024977825582027435,
      "mae_dx": 0.010271113365888596,
      "mae_dy": 0.002993403933942318,
      "pose_mae_dtheta": 0.2118498980998993,
      "pose_mae_dx": 0.09003662317991257,
      "pose_mae_dy": 0.035947106778621674,
      "pose_rmse_dtheta": 0.4091652035713196,
      "pose_rmse_dx": 0.23680061101913452,
      "pose_rmse_dy": 0.08530215173959732,
      "pose_rmse_mean": 0.2437559962272644,
      "rmse_dtheta": 0.04282727092504501,
      "rmse_dx": 0.023118453100323677,
      "rmse_dy": 0.005574219394475222,
      "rmse_mean": 0.023839980363845825,
      "rotation_flip": 0.014184396713972092,
      "sparse_tokens": 7806.0,
      "step": 3826,
      "turn_loss": 0.20644435286521912,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.17780152388031964,
      "grad_norm": 1.0355719327926636,
      "learning_rate": 7.784993060588667e-06,
      "loss": 0.2652,
      "mae_dtheta": 0.03382344916462898,
      "mae_dx": 0.013703771866858006,
      "mae_dy": 0.003920492250472307,
      "pose_mae_dtheta": 0.30792301893234253,
      "pose_mae_dx": 0.09031606465578079,
      "pose_mae_dy": 0.05346358194947243,
      "pose_rmse_dtheta": 0.5886633992195129,
      "pose_rmse_dx": 0.18309012055397034,
      "pose_rmse_dy": 0.10083039849996567,
      "pose_rmse_mean": 0.2908613085746765,
      "rmse_dtheta": 0.05582910776138306,
      "rmse_dx": 0.024979645386338234,
      "rmse_dy": 0.006629934534430504,
      "rmse_mean": 0.029146229848265648,
      "rotation_flip": 0.009999999776482582,
      "sparse_tokens": 3795.0,
      "step": 3827,
      "turn_loss": 0.2622174322605133,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.17784798364616242,
      "grad_norm": 0.6248204708099365,
      "learning_rate": 7.783894842487323e-06,
      "loss": 0.0948,
      "mae_dtheta": 0.011962410062551498,
      "mae_dx": 0.0019346890039741993,
      "mae_dy": 0.0019883469212800264,
      "pose_mae_dtheta": 0.08540336042642593,
      "pose_mae_dx": 0.02223171480000019,
      "pose_mae_dy": 0.026558171957731247,
      "pose_rmse_dtheta": 0.25331753492355347,
      "pose_rmse_dx": 0.06700083613395691,
      "pose_rmse_dy": 0.0879991427063942,
      "pose_rmse_mean": 0.13610583543777466,
      "rmse_dtheta": 0.028308434411883354,
      "rmse_dx": 0.006290064193308353,
      "rmse_dy": 0.0047585382126271725,
      "rmse_mean": 0.013119012117385864,
      "rotation_flip": 0.0032760032918304205,
      "sparse_tokens": 32105.0,
      "step": 3828,
      "turn_loss": 0.08215008676052094,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1778944434120052,
      "grad_norm": 0.45105987787246704,
      "learning_rate": 7.782796429706721e-06,
      "loss": 0.0795,
      "mae_dtheta": 0.004897112958133221,
      "mae_dx": 0.001247084466740489,
      "mae_dy": 0.0007022061035968363,
      "pose_mae_dtheta": 0.03606494516134262,
      "pose_mae_dx": 0.012004496529698372,
      "pose_mae_dy": 0.009362411685287952,
      "pose_rmse_dtheta": 0.16194091737270355,
      "pose_rmse_dx": 0.044205471873283386,
      "pose_rmse_dy": 0.028144164010882378,
      "pose_rmse_mean": 0.07809685170650482,
      "rmse_dtheta": 0.019226839765906334,
      "rmse_dx": 0.005126892123371363,
      "rmse_dy": 0.0013935640454292297,
      "rmse_mean": 0.008582431823015213,
      "rotation_flip": 0.0010893245926126838,
      "sparse_tokens": 32057.0,
      "step": 3829,
      "turn_loss": 0.037760600447654724,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17794090317784797,
      "grad_norm": 0.46705520153045654,
      "learning_rate": 7.781697822323669e-06,
      "loss": 0.0887,
      "mae_dtheta": 0.00911041535437107,
      "mae_dx": 0.0015323563711717725,
      "mae_dy": 0.0018587623490020633,
      "pose_mae_dtheta": 0.059936102479696274,
      "pose_mae_dx": 0.019221320748329163,
      "pose_mae_dy": 0.023594221100211143,
      "pose_rmse_dtheta": 0.14105242490768433,
      "pose_rmse_dx": 0.04414840787649155,
      "pose_rmse_dy": 0.057210374623537064,
      "pose_rmse_mean": 0.08080373704433441,
      "rmse_dtheta": 0.020133817568421364,
      "rmse_dx": 0.004390568006783724,
      "rmse_dy": 0.004538779612630606,
      "rmse_mean": 0.009687721729278564,
      "rotation_flip": 0.007926023565232754,
      "sparse_tokens": 32089.0,
      "step": 3830,
      "turn_loss": 0.07344036549329758,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17798736294369077,
      "grad_norm": 0.5127286314964294,
      "learning_rate": 7.780599020414997e-06,
      "loss": 0.1709,
      "mae_dtheta": 0.014474853873252869,
      "mae_dx": 0.002924575936049223,
      "mae_dy": 0.003210886148735881,
      "pose_mae_dtheta": 0.10394822806119919,
      "pose_mae_dx": 0.03999636694788933,
      "pose_mae_dy": 0.042786624282598495,
      "pose_rmse_dtheta": 0.22002269327640533,
      "pose_rmse_dx": 0.09257514774799347,
      "pose_rmse_dy": 0.09778833389282227,
      "pose_rmse_mean": 0.13679540157318115,
      "rmse_dtheta": 0.027744580060243607,
      "rmse_dx": 0.007826192304491997,
      "rmse_dy": 0.006560678128153086,
      "rmse_mean": 0.014043817296624184,
      "rotation_flip": 0.00587803078815341,
      "sparse_tokens": 32089.0,
      "step": 3831,
      "turn_loss": 0.12166059762239456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17803382270953355,
      "grad_norm": 0.40916216373443604,
      "learning_rate": 7.77950002405754e-06,
      "loss": 0.1296,
      "mae_dtheta": 0.007715487387031317,
      "mae_dx": 0.0017523127608001232,
      "mae_dy": 0.002240142785012722,
      "pose_mae_dtheta": 0.05262838304042816,
      "pose_mae_dx": 0.019455010071396828,
      "pose_mae_dy": 0.02362537384033203,
      "pose_rmse_dtheta": 0.11047779023647308,
      "pose_rmse_dx": 0.04962000995874405,
      "pose_rmse_dy": 0.060046982020139694,
      "pose_rmse_mean": 0.07338160276412964,
      "rmse_dtheta": 0.016335085034370422,
      "rmse_dx": 0.0059253498911857605,
      "rmse_dy": 0.005057918839156628,
      "rmse_mean": 0.009106118232011795,
      "rotation_flip": 0.0034100597258657217,
      "sparse_tokens": 32089.0,
      "step": 3832,
      "turn_loss": 0.06938137859106064,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.17808028247537633,
      "grad_norm": 0.5229150056838989,
      "learning_rate": 7.778400833328157e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.011588779278099537,
      "mae_dx": 0.0027391272597014904,
      "mae_dy": 0.0026172029320150614,
      "pose_mae_dtheta": 0.07895597815513611,
      "pose_mae_dx": 0.0315229706466198,
      "pose_mae_dy": 0.02895921841263771,
      "pose_rmse_dtheta": 0.21449004113674164,
      "pose_rmse_dx": 0.07954486459493637,
      "pose_rmse_dy": 0.06573770195245743,
      "pose_rmse_mean": 0.11992420256137848,
      "rmse_dtheta": 0.026678338646888733,
      "rmse_dx": 0.007582874037325382,
      "rmse_dy": 0.005897233262658119,
      "rmse_mean": 0.013386148028075695,
      "rotation_flip": 0.006244795862585306,
      "sparse_tokens": 32105.0,
      "step": 3833,
      "turn_loss": 0.1122078001499176,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.1781267422412191,
      "grad_norm": 0.48170205950737,
      "learning_rate": 7.77730144830371e-06,
      "loss": 0.0882,
      "mae_dtheta": 0.029281947761774063,
      "mae_dx": 0.013544168323278427,
      "mae_dy": 0.004109436646103859,
      "pose_mae_dtheta": 0.24728459119796753,
      "pose_mae_dx": 0.09759179502725601,
      "pose_mae_dy": 0.053833238780498505,
      "pose_rmse_dtheta": 0.45201000571250916,
      "pose_rmse_dx": 0.2149500995874405,
      "pose_rmse_dy": 0.14103199541568756,
      "pose_rmse_mean": 0.2693307101726532,
      "rmse_dtheta": 0.04629519209265709,
      "rmse_dx": 0.026738379150629044,
      "rmse_dy": 0.008150973357260227,
      "rmse_mean": 0.02706151455640793,
      "rotation_flip": 0.010482179932296276,
      "sparse_tokens": 8797.0,
      "step": 3834,
      "turn_loss": 0.27836883068084717,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.17817320200706188,
      "grad_norm": 0.3885878920555115,
      "learning_rate": 7.776201869061086e-06,
      "loss": 0.0952,
      "mae_dtheta": 0.009996561333537102,
      "mae_dx": 0.0020823960658162832,
      "mae_dy": 0.002248025732114911,
      "pose_mae_dtheta": 0.07474023848772049,
      "pose_mae_dx": 0.021467747166752815,
      "pose_mae_dy": 0.025158174335956573,
      "pose_rmse_dtheta": 0.19112926721572876,
      "pose_rmse_dx": 0.05608315393328667,
      "pose_rmse_dy": 0.0635630190372467,
      "pose_rmse_mean": 0.10359182208776474,
      "rmse_dtheta": 0.024512192234396935,
      "rmse_dx": 0.006780714727938175,
      "rmse_dy": 0.006652651354670525,
      "rmse_mean": 0.012648520991206169,
      "rotation_flip": 0.0062949638813734055,
      "sparse_tokens": 32121.0,
      "step": 3835,
      "turn_loss": 0.08346898853778839,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.17821966177290466,
      "grad_norm": 0.5413634181022644,
      "learning_rate": 7.775102095677172e-06,
      "loss": 0.1341,
      "mae_dtheta": 0.011910215020179749,
      "mae_dx": 0.0034004768822342157,
      "mae_dy": 0.004313965793699026,
      "pose_mae_dtheta": 0.08760654926300049,
      "pose_mae_dx": 0.04048982635140419,
      "pose_mae_dy": 0.04065994545817375,
      "pose_rmse_dtheta": 0.23808132112026215,
      "pose_rmse_dx": 0.11757596582174301,
      "pose_rmse_dy": 0.12030752748250961,
      "pose_rmse_mean": 0.15865494310855865,
      "rmse_dtheta": 0.026680421084165573,
      "rmse_dx": 0.011628285981714725,
      "rmse_dy": 0.012909443117678165,
      "rmse_mean": 0.01707271672785282,
      "rotation_flip": 0.004613200668245554,
      "sparse_tokens": 32137.0,
      "step": 3836,
      "turn_loss": 0.14164510369300842,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.17826612153874744,
      "grad_norm": 0.6176081895828247,
      "learning_rate": 7.77400212822888e-06,
      "loss": 0.1456,
      "mae_dtheta": 0.03872808814048767,
      "mae_dx": 0.011004654690623283,
      "mae_dy": 0.0052545941434800625,
      "pose_mae_dtheta": 0.3371022343635559,
      "pose_mae_dx": 0.07477174699306488,
      "pose_mae_dy": 0.07620628923177719,
      "pose_rmse_dtheta": 0.5807505249977112,
      "pose_rmse_dx": 0.18220973014831543,
      "pose_rmse_dy": 0.22967487573623657,
      "pose_rmse_mean": 0.3308783769607544,
      "rmse_dtheta": 0.05831900238990784,
      "rmse_dx": 0.023406188935041428,
      "rmse_dy": 0.010370232164859772,
      "rmse_mean": 0.03069847635924816,
      "rotation_flip": 0.015025041997432709,
      "sparse_tokens": 11039.0,
      "step": 3837,
      "turn_loss": 0.2610301673412323,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1783125813045902,
      "grad_norm": 0.3755442202091217,
      "learning_rate": 7.772901966793132e-06,
      "loss": 0.0732,
      "mae_dtheta": 0.007852964103221893,
      "mae_dx": 0.0011085083242505789,
      "mae_dy": 0.0010726872133091092,
      "pose_mae_dtheta": 0.05864756181836128,
      "pose_mae_dx": 0.008965219371020794,
      "pose_mae_dy": 0.015312699601054192,
      "pose_rmse_dtheta": 0.21799102425575256,
      "pose_rmse_dx": 0.026788195595145226,
      "pose_rmse_dy": 0.0381489060819149,
      "pose_rmse_mean": 0.09430937469005585,
      "rmse_dtheta": 0.02471192739903927,
      "rmse_dx": 0.004171621520072222,
      "rmse_dy": 0.0046280762180686,
      "rmse_mean": 0.011170541867613792,
      "rotation_flip": 0.004036908969283104,
      "sparse_tokens": 32105.0,
      "step": 3838,
      "turn_loss": 0.040510352700948715,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.17835904107043302,
      "grad_norm": 0.540031909942627,
      "learning_rate": 7.771801611446859e-06,
      "loss": 0.1974,
      "mae_dtheta": 0.012982383370399475,
      "mae_dx": 0.0027434194926172495,
      "mae_dy": 0.0028888157103210688,
      "pose_mae_dtheta": 0.08626973628997803,
      "pose_mae_dx": 0.03384924679994583,
      "pose_mae_dy": 0.03563914820551872,
      "pose_rmse_dtheta": 0.186125248670578,
      "pose_rmse_dx": 0.0957491546869278,
      "pose_rmse_dy": 0.08109202980995178,
      "pose_rmse_mean": 0.12098881602287292,
      "rmse_dtheta": 0.02646060660481453,
      "rmse_dx": 0.008670605719089508,
      "rmse_dy": 0.007362766657024622,
      "rmse_mean": 0.01416466012597084,
      "rotation_flip": 0.004085338208824396,
      "sparse_tokens": 32057.0,
      "step": 3839,
      "turn_loss": 0.11268684267997742,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1784055008362758,
      "grad_norm": 0.4461045563220978,
      "learning_rate": 7.770701062267011e-06,
      "loss": 0.1438,
      "mae_dtheta": 0.010026802308857441,
      "mae_dx": 0.0019784539472311735,
      "mae_dy": 0.0024827090092003345,
      "pose_mae_dtheta": 0.07810018956661224,
      "pose_mae_dx": 0.024833347648382187,
      "pose_mae_dy": 0.029396163299679756,
      "pose_rmse_dtheta": 0.2249404340982437,
      "pose_rmse_dx": 0.07229561358690262,
      "pose_rmse_dy": 0.07887282222509384,
      "pose_rmse_mean": 0.12536963820457458,
      "rmse_dtheta": 0.024039510637521744,
      "rmse_dx": 0.005888078361749649,
      "rmse_dy": 0.005603930447250605,
      "rmse_mean": 0.011843840591609478,
      "rotation_flip": 0.004211332183331251,
      "sparse_tokens": 32105.0,
      "step": 3840,
      "turn_loss": 0.08392570167779922,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.17845196060211857,
      "grad_norm": 0.4628007411956787,
      "learning_rate": 7.769600319330553e-06,
      "loss": 0.1195,
      "mae_dtheta": 0.03420594707131386,
      "mae_dx": 0.01506362110376358,
      "mae_dy": 0.008889247663319111,
      "pose_mae_dtheta": 0.27180588245391846,
      "pose_mae_dx": 0.11582356691360474,
      "pose_mae_dy": 0.1061536967754364,
      "pose_rmse_dtheta": 0.4050545394420624,
      "pose_rmse_dx": 0.2139114886522293,
      "pose_rmse_dy": 0.21154680848121643,
      "pose_rmse_mean": 0.27683764696121216,
      "rmse_dtheta": 0.04660901427268982,
      "rmse_dx": 0.026939308270812035,
      "rmse_dy": 0.014280655421316624,
      "rmse_mean": 0.029276326298713684,
      "rotation_flip": 0.01689189113676548,
      "sparse_tokens": 10433.0,
      "step": 3841,
      "turn_loss": 0.28323957324028015,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 34930.0,
      "epoch": 0.17849842036796135,
      "grad_norm": 0.6560348272323608,
      "learning_rate": 7.768499382714457e-06,
      "loss": 0.1822,
      "mae_dtheta": 0.038084205240011215,
      "mae_dx": 0.012202036567032337,
      "mae_dy": 0.0063108839094638824,
      "pose_mae_dtheta": 0.3093731701374054,
      "pose_mae_dx": 0.09316668659448624,
      "pose_mae_dy": 0.07435725629329681,
      "pose_rmse_dtheta": 0.511725127696991,
      "pose_rmse_dx": 0.1930382400751114,
      "pose_rmse_dy": 0.1692284643650055,
      "pose_rmse_mean": 0.29133063554763794,
      "rmse_dtheta": 0.055638387799263,
      "rmse_dx": 0.023670285940170288,
      "rmse_dy": 0.012001779861748219,
      "rmse_mean": 0.030436819419264793,
      "rotation_flip": 0.013087447732686996,
      "sparse_tokens": 26400.0,
      "step": 3842,
      "turn_loss": 0.3059505224227905,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17854488013380412,
      "grad_norm": 0.5451680421829224,
      "learning_rate": 7.767398252495713e-06,
      "loss": 0.102,
      "mae_dtheta": 0.009685358963906765,
      "mae_dx": 0.003190369112417102,
      "mae_dy": 0.002420871751382947,
      "pose_mae_dtheta": 0.06405404955148697,
      "pose_mae_dx": 0.03541320562362671,
      "pose_mae_dy": 0.03243611752986908,
      "pose_rmse_dtheta": 0.13352134823799133,
      "pose_rmse_dx": 0.11102654784917831,
      "pose_rmse_dy": 0.07528755813837051,
      "pose_rmse_mean": 0.10661181807518005,
      "rmse_dtheta": 0.01952826790511608,
      "rmse_dx": 0.011078434996306896,
      "rmse_dy": 0.005008113104850054,
      "rmse_mean": 0.011871605180203915,
      "rotation_flip": 0.008796481415629387,
      "sparse_tokens": 32089.0,
      "step": 3843,
      "turn_loss": 0.10927753150463104,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.1785913398996469,
      "grad_norm": 0.43403735756874084,
      "learning_rate": 7.766296928751323e-06,
      "loss": 0.1641,
      "mae_dtheta": 0.02680269442498684,
      "mae_dx": 0.010615956969559193,
      "mae_dy": 0.003861063625663519,
      "pose_mae_dtheta": 0.21050624549388885,
      "pose_mae_dx": 0.084648996591568,
      "pose_mae_dy": 0.0515764094889164,
      "pose_rmse_dtheta": 0.4178829789161682,
      "pose_rmse_dx": 0.2085483819246292,
      "pose_rmse_dy": 0.13303737342357635,
      "pose_rmse_mean": 0.25315624475479126,
      "rmse_dtheta": 0.046991344541311264,
      "rmse_dx": 0.02336190827190876,
      "rmse_dy": 0.008365178480744362,
      "rmse_mean": 0.02623947709798813,
      "rotation_flip": 0.018850142136216164,
      "sparse_tokens": 22593.0,
      "step": 3844,
      "turn_loss": 0.19474618136882782,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.17863779966548968,
      "grad_norm": 0.5067090392112732,
      "learning_rate": 7.765195411558306e-06,
      "loss": 0.1133,
      "mae_dtheta": 0.007897622883319855,
      "mae_dx": 0.0022832034155726433,
      "mae_dy": 0.0016431387048214674,
      "pose_mae_dtheta": 0.059034597128629684,
      "pose_mae_dx": 0.01904328539967537,
      "pose_mae_dy": 0.016431551426649094,
      "pose_rmse_dtheta": 0.1766514778137207,
      "pose_rmse_dx": 0.04505462571978569,
      "pose_rmse_dy": 0.038618382066488266,
      "pose_rmse_mean": 0.08677482604980469,
      "rmse_dtheta": 0.02110607735812664,
      "rmse_dx": 0.007210385985672474,
      "rmse_dy": 0.0055225929245352745,
      "rmse_mean": 0.011279686354100704,
      "rotation_flip": 0.004214074928313494,
      "sparse_tokens": 32169.0,
      "step": 3845,
      "turn_loss": 0.07235574722290039,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.17868425943133245,
      "grad_norm": 0.5816784501075745,
      "learning_rate": 7.764093700993688e-06,
      "loss": 0.1544,
      "mae_dtheta": 0.013207974843680859,
      "mae_dx": 0.003358502872288227,
      "mae_dy": 0.004468208644539118,
      "pose_mae_dtheta": 0.1057763621211052,
      "pose_mae_dx": 0.0393533818423748,
      "pose_mae_dy": 0.03680291399359703,
      "pose_rmse_dtheta": 0.2673890292644501,
      "pose_rmse_dx": 0.1174272894859314,
      "pose_rmse_dy": 0.10965792089700699,
      "pose_rmse_mean": 0.16482475399971008,
      "rmse_dtheta": 0.029894623905420303,
      "rmse_dx": 0.0089494613930583,
      "rmse_dy": 0.011694703251123428,
      "rmse_mean": 0.01684626378118992,
      "rotation_flip": 0.007174172904342413,
      "sparse_tokens": 32105.0,
      "step": 3846,
      "turn_loss": 0.13930624723434448,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.17873071919717526,
      "grad_norm": 0.5672239065170288,
      "learning_rate": 7.762991797134513e-06,
      "loss": 0.1644,
      "mae_dtheta": 0.03094133734703064,
      "mae_dx": 0.011501629836857319,
      "mae_dy": 0.006498728413134813,
      "pose_mae_dtheta": 0.2175516039133072,
      "pose_mae_dx": 0.0858018696308136,
      "pose_mae_dy": 0.06930211186408997,
      "pose_rmse_dtheta": 0.38555893301963806,
      "pose_rmse_dx": 0.18842539191246033,
      "pose_rmse_dy": 0.14156746864318848,
      "pose_rmse_mean": 0.23851726949214935,
      "rmse_dtheta": 0.04642697423696518,
      "rmse_dx": 0.023979060351848602,
      "rmse_dy": 0.012948521412909031,
      "rmse_mean": 0.02778485231101513,
      "rotation_flip": 0.010688835754990578,
      "sparse_tokens": 14524.0,
      "step": 3847,
      "turn_loss": 0.3081027865409851,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.17877717896301804,
      "grad_norm": 0.7521955370903015,
      "learning_rate": 7.761889700057841e-06,
      "loss": 0.1106,
      "mae_dtheta": 0.0342596136033535,
      "mae_dx": 0.011970237828791142,
      "mae_dy": 0.004615379497408867,
      "pose_mae_dtheta": 0.2865966558456421,
      "pose_mae_dx": 0.09505300968885422,
      "pose_mae_dy": 0.05034505948424339,
      "pose_rmse_dtheta": 0.5052822232246399,
      "pose_rmse_dx": 0.19721455872058868,
      "pose_rmse_dy": 0.13556329905986786,
      "pose_rmse_mean": 0.27935338020324707,
      "rmse_dtheta": 0.05188530683517456,
      "rmse_dx": 0.023485364392399788,
      "rmse_dy": 0.009861592203378677,
      "rmse_mean": 0.02841075323522091,
      "rotation_flip": 0.015625,
      "sparse_tokens": 16309.0,
      "step": 3848,
      "turn_loss": 0.25520458817481995,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.1788236387288608,
      "grad_norm": 0.4716581404209137,
      "learning_rate": 7.76078740984074e-06,
      "loss": 0.1357,
      "mae_dtheta": 0.02830146625638008,
      "mae_dx": 0.008686253800988197,
      "mae_dy": 0.0055211568251252174,
      "pose_mae_dtheta": 0.22224432229995728,
      "pose_mae_dx": 0.06023741886019707,
      "pose_mae_dy": 0.06165862828493118,
      "pose_rmse_dtheta": 0.438996821641922,
      "pose_rmse_dx": 0.15753355622291565,
      "pose_rmse_dy": 0.16204982995986938,
      "pose_rmse_mean": 0.25286006927490234,
      "rmse_dtheta": 0.04643399268388748,
      "rmse_dx": 0.019861118867993355,
      "rmse_dy": 0.013207698240876198,
      "rmse_mean": 0.026500936597585678,
      "rotation_flip": 0.00920245423913002,
      "sparse_tokens": 12624.0,
      "step": 3849,
      "turn_loss": 0.24387119710445404,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.1788700984947036,
      "grad_norm": 0.5347403287887573,
      "learning_rate": 7.759684926560292e-06,
      "loss": 0.1454,
      "mae_dtheta": 0.032085731625556946,
      "mae_dx": 0.012491107918322086,
      "mae_dy": 0.009446495212614536,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.534740149974823,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.7347412109375,
      "model/head/act_norm_mean": 103.60663805509868,
      "model/head/act_norm_min": 62.93825912475586,
      "model/head/act_over_embed": 71.19945165209158,
      "model/head/grad_frac": 0.11767081916332245,
      "model/head/grad_norm": 0.06292331218719482,
      "model/head/grad_zero_frac": 0.00016561587108299136,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6903268914473685,
      "model/head/update_ratio": 0.0010819820454344153,
      "model/head/weight_delta": 7.327916622161865,
      "model/head/weight_delta_rel": 0.1285533607006073,
      "model/head/weight_norm": 58.15559768676758,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4172784388065338,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41722607612609863,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4171672761440277,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2867216656459218,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07195639610290527,
      "model/modality_embedder.encoders.pose/grad_norm": 0.038477975875139236,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5435546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012465495383366942,
      "model/modality_embedder.encoders.pose/weight_delta": 2.398571491241455,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07836880534887314,
      "model/modality_embedder.encoders.pose/weight_norm": 30.867586135864258,
      "model/modality_embedder/grad_frac": 0.07195639610290527,
      "model/modality_embedder/grad_norm": 0.038477975875139236,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5435546875,
      "model/modality_embedder/update_ratio": 0.0012465495383366942,
      "model/modality_embedder/weight_delta": 2.398571491241455,
      "model/modality_embedder/weight_delta_rel": 0.07836880534887314,
      "model/modality_embedder/weight_norm": 30.867586135864258,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.19168090820312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.966181730367584,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.164789199829102,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.782575097889545,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09256865829229355,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.049500178545713425,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.00178456527646631,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.7009934186935425,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06198522821068764,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.737947463989258,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.03173828125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.865670034461154,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.308305740356445,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.400711881604828,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09044606238603592,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.048365142196416855,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001645068870857358,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.1479380130767822,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07440625131130219,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.40007209777832,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.68305969238281,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.54310581140351,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.574066162109375,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.553461451920786,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09139154851436615,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04887073114514351,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016102383378893137,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.3031136989593506,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07733424752950668,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.349998474121094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.7786636352539,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.561641734544693,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.380112648010254,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.94061823613446,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09654973447322845,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.051629018038511276,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001740230480208993,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.9662549495697021,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06719726324081421,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.667919158935547,
      "model/normalizer/grad_frac": 0.35756900906562805,
      "model/normalizer/grad_norm": 0.19120649993419647,
      "model/normalizer/grad_zero_frac": 0.00019144162070006132,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0024437732063233852,
      "model/normalizer/weight_delta": 4.179673671722412,
      "model/normalizer/weight_delta_rel": 0.05383177846670151,
      "model/normalizer/weight_norm": 78.24232482910156,
      "pose_mae_dtheta": 0.2220010757446289,
      "pose_mae_dx": 0.1155606135725975,
      "pose_mae_dy": 0.12638577818870544,
      "pose_rmse_dtheta": 0.39550623297691345,
      "pose_rmse_dx": 0.22924037277698517,
      "pose_rmse_dy": 0.2232765108346939,
      "pose_rmse_mean": 0.2826743721961975,
      "rmse_dtheta": 0.04777735471725464,
      "rmse_dx": 0.024743124842643738,
      "rmse_dy": 0.016751663759350777,
      "rmse_mean": 0.029757380485534668,
      "rotation_flip": 0.0036900369450449944,
      "sparse_tokens": 5084.0,
      "step": 3850,
      "turn_loss": 0.31913718581199646,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.17891655826054637,
      "grad_norm": 0.6775557398796082,
      "learning_rate": 7.758582250293596e-06,
      "loss": 0.0784,
      "mae_dtheta": 0.009656191803514957,
      "mae_dx": 0.0018480687867850065,
      "mae_dy": 0.0016683123540133238,
      "pose_mae_dtheta": 0.06531787663698196,
      "pose_mae_dx": 0.020658010616898537,
      "pose_mae_dy": 0.01908150129020214,
      "pose_rmse_dtheta": 0.22046054899692535,
      "pose_rmse_dx": 0.05071801319718361,
      "pose_rmse_dy": 0.04686020314693451,
      "pose_rmse_mean": 0.10601292550563812,
      "rmse_dtheta": 0.02525791898369789,
      "rmse_dx": 0.005036563146859407,
      "rmse_dy": 0.003950890619307756,
      "rmse_mean": 0.01141512393951416,
      "rotation_flip": 0.002685078652575612,
      "sparse_tokens": 32169.0,
      "step": 3851,
      "turn_loss": 0.0702160969376564,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.17896301802638914,
      "grad_norm": 0.4002838134765625,
      "learning_rate": 7.757479381117762e-06,
      "loss": 0.1171,
      "mae_dtheta": 0.03747299686074257,
      "mae_dx": 0.011485512368381023,
      "mae_dy": 0.006228138692677021,
      "pose_mae_dtheta": 0.31415000557899475,
      "pose_mae_dx": 0.09363234043121338,
      "pose_mae_dy": 0.08532466739416122,
      "pose_rmse_dtheta": 0.5278151035308838,
      "pose_rmse_dx": 0.1781826615333557,
      "pose_rmse_dy": 0.1536821573972702,
      "pose_rmse_mean": 0.2865599989891052,
      "rmse_dtheta": 0.0552489273250103,
      "rmse_dx": 0.022651491686701775,
      "rmse_dy": 0.010335730388760567,
      "rmse_mean": 0.029412049800157547,
      "rotation_flip": 0.013452914543449879,
      "sparse_tokens": 4185.0,
      "step": 3852,
      "turn_loss": 0.20967093110084534,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 12961.0,
      "epoch": 0.17900947779223192,
      "grad_norm": 0.49851441383361816,
      "learning_rate": 7.756376319109917e-06,
      "loss": 0.1288,
      "mae_dtheta": 0.02339780330657959,
      "mae_dx": 0.011567485518753529,
      "mae_dy": 0.004281537141650915,
      "pose_mae_dtheta": 0.17984101176261902,
      "pose_mae_dx": 0.09056375175714493,
      "pose_mae_dy": 0.08638498187065125,
      "pose_rmse_dtheta": 0.3435335159301758,
      "pose_rmse_dx": 0.21240703761577606,
      "pose_rmse_dy": 0.1770881563425064,
      "pose_rmse_mean": 0.24434290826320648,
      "rmse_dtheta": 0.03780052810907364,
      "rmse_dx": 0.02532784454524517,
      "rmse_dy": 0.0072961305268108845,
      "rmse_mean": 0.023474834859371185,
      "rotation_flip": 0.008602150715887547,
      "sparse_tokens": 10834.0,
      "step": 3853,
      "turn_loss": 0.1622762680053711,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 1986.0,
      "epoch": 0.1790559375580747,
      "grad_norm": 0.6902446746826172,
      "learning_rate": 7.755273064347195e-06,
      "loss": 0.1915,
      "mae_dtheta": 0.04199645295739174,
      "mae_dx": 0.012544338591396809,
      "mae_dy": 0.011980158276855946,
      "pose_mae_dtheta": 0.3192996084690094,
      "pose_mae_dx": 0.14995113015174866,
      "pose_mae_dy": 0.11871131509542465,
      "pose_rmse_dtheta": 0.4719945788383484,
      "pose_rmse_dx": 0.27143236994743347,
      "pose_rmse_dy": 0.20856116712093353,
      "pose_rmse_mean": 0.31732937693595886,
      "rmse_dtheta": 0.05467284843325615,
      "rmse_dx": 0.019740203395485878,
      "rmse_dy": 0.018894173204898834,
      "rmse_mean": 0.031102409586310387,
      "rotation_flip": 0.0,
      "sparse_tokens": 1725.0,
      "step": 3854,
      "turn_loss": 0.3758208751678467,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1791023973239175,
      "grad_norm": 0.7724488377571106,
      "learning_rate": 7.75416961690675e-06,
      "loss": 0.123,
      "mae_dtheta": 0.01593000441789627,
      "mae_dx": 0.0020780793856829405,
      "mae_dy": 0.0034435789566487074,
      "pose_mae_dtheta": 0.10608261078596115,
      "pose_mae_dx": 0.02884678542613983,
      "pose_mae_dy": 0.038794878870248795,
      "pose_rmse_dtheta": 0.24674883484840393,
      "pose_rmse_dx": 0.07946114242076874,
      "pose_rmse_dy": 0.09112031757831573,
      "pose_rmse_mean": 0.13911008834838867,
      "rmse_dtheta": 0.030317984521389008,
      "rmse_dx": 0.005739826709032059,
      "rmse_dy": 0.008065009489655495,
      "rmse_mean": 0.01470760814845562,
      "rotation_flip": 0.005366726312786341,
      "sparse_tokens": 32105.0,
      "step": 3855,
      "turn_loss": 0.12272612005472183,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17914885708976028,
      "grad_norm": 0.44654497504234314,
      "learning_rate": 7.753065976865745e-06,
      "loss": 0.0813,
      "mae_dtheta": 0.00948469340801239,
      "mae_dx": 0.0018043821910396218,
      "mae_dy": 0.0021406118758022785,
      "pose_mae_dtheta": 0.06555479764938354,
      "pose_mae_dx": 0.0232520904392004,
      "pose_mae_dy": 0.026764310896396637,
      "pose_rmse_dtheta": 0.1685117781162262,
      "pose_rmse_dx": 0.06234145537018776,
      "pose_rmse_dy": 0.0663251057267189,
      "pose_rmse_mean": 0.09905944764614105,
      "rmse_dtheta": 0.022113045677542686,
      "rmse_dx": 0.00591743690893054,
      "rmse_dy": 0.004955568816512823,
      "rmse_mean": 0.010995350778102875,
      "rotation_flip": 0.004267425276339054,
      "sparse_tokens": 32089.0,
      "step": 3856,
      "turn_loss": 0.08322127908468246,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.17919531685560305,
      "grad_norm": 0.5222666263580322,
      "learning_rate": 7.751962144301359e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.05353953316807747,
      "mae_dx": 0.006107877008616924,
      "mae_dy": 0.0013543707318603992,
      "pose_mae_dtheta": 0.5237646698951721,
      "pose_mae_dx": 0.0713430643081665,
      "pose_mae_dy": 0.011145930737257004,
      "pose_rmse_dtheta": 0.7728669047355652,
      "pose_rmse_dx": 0.1866568624973297,
      "pose_rmse_dy": 0.025120364502072334,
      "pose_rmse_mean": 0.32821473479270935,
      "rmse_dtheta": 0.07139965891838074,
      "rmse_dx": 0.016710564494132996,
      "rmse_dy": 0.003468546085059643,
      "rmse_mean": 0.030526256188750267,
      "rotation_flip": 0.015706805512309074,
      "sparse_tokens": 6323.0,
      "step": 3857,
      "turn_loss": 0.33882391452789307,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.17924177662144583,
      "grad_norm": 0.3748829662799835,
      "learning_rate": 7.750858119290781e-06,
      "loss": 0.0964,
      "mae_dtheta": 0.05799352005124092,
      "mae_dx": 0.01613999344408512,
      "mae_dy": 0.006987458094954491,
      "pose_mae_dtheta": 0.5051695108413696,
      "pose_mae_dx": 0.1145247295498848,
      "pose_mae_dy": 0.08030161261558533,
      "pose_rmse_dtheta": 0.788503885269165,
      "pose_rmse_dx": 0.21094056963920593,
      "pose_rmse_dy": 0.1648155301809311,
      "pose_rmse_mean": 0.3880866765975952,
      "rmse_dtheta": 0.07790951430797577,
      "rmse_dx": 0.029381152242422104,
      "rmse_dy": 0.011820850893855095,
      "rmse_mean": 0.039703842252492905,
      "rotation_flip": 0.018099548295140266,
      "sparse_tokens": 3848.0,
      "step": 3858,
      "turn_loss": 0.35671335458755493,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1792882363872886,
      "grad_norm": 0.554533064365387,
      "learning_rate": 7.74975390191122e-06,
      "loss": 0.1674,
      "mae_dtheta": 0.01110447384417057,
      "mae_dx": 0.0017860315274447203,
      "mae_dy": 0.0019104091916233301,
      "pose_mae_dtheta": 0.07696714252233505,
      "pose_mae_dx": 0.02316961996257305,
      "pose_mae_dy": 0.029175540432333946,
      "pose_rmse_dtheta": 0.18734745681285858,
      "pose_rmse_dx": 0.05513722449541092,
      "pose_rmse_dy": 0.07199100404977798,
      "pose_rmse_mean": 0.1048252284526825,
      "rmse_dtheta": 0.02515094168484211,
      "rmse_dx": 0.00499173766002059,
      "rmse_dy": 0.003984792158007622,
      "rmse_mean": 0.01137582492083311,
      "rotation_flip": 0.00585774052888155,
      "sparse_tokens": 32089.0,
      "step": 3859,
      "turn_loss": 0.09046979993581772,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17933469615313138,
      "grad_norm": 0.5202335715293884,
      "learning_rate": 7.748649492239892e-06,
      "loss": 0.1175,
      "mae_dtheta": 0.012747157365083694,
      "mae_dx": 0.002926482353359461,
      "mae_dy": 0.004263536538928747,
      "pose_mae_dtheta": 0.08831053227186203,
      "pose_mae_dx": 0.035609159618616104,
      "pose_mae_dy": 0.04409559443593025,
      "pose_rmse_dtheta": 0.19660153985023499,
      "pose_rmse_dx": 0.10213655233383179,
      "pose_rmse_dy": 0.12114610522985458,
      "pose_rmse_mean": 0.13996140658855438,
      "rmse_dtheta": 0.026321852579712868,
      "rmse_dx": 0.00908483937382698,
      "rmse_dy": 0.01095815934240818,
      "rmse_mean": 0.015454950742423534,
      "rotation_flip": 0.007572737988084555,
      "sparse_tokens": 32089.0,
      "step": 3860,
      "turn_loss": 0.13189628720283508,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.17938115591897416,
      "grad_norm": 0.4291708171367645,
      "learning_rate": 7.747544890354031e-06,
      "loss": 0.1484,
      "mae_dtheta": 0.01176209282130003,
      "mae_dx": 0.0026027231942862272,
      "mae_dy": 0.002941968385130167,
      "pose_mae_dtheta": 0.0845220535993576,
      "pose_mae_dx": 0.028329333290457726,
      "pose_mae_dy": 0.0336955264210701,
      "pose_rmse_dtheta": 0.19464413821697235,
      "pose_rmse_dx": 0.08139993250370026,
      "pose_rmse_dy": 0.08863133937120438,
      "pose_rmse_mean": 0.12155847251415253,
      "rmse_dtheta": 0.024761773645877838,
      "rmse_dx": 0.007218059152364731,
      "rmse_dy": 0.007417894434183836,
      "rmse_mean": 0.013132575899362564,
      "rotation_flip": 0.011541632004082203,
      "sparse_tokens": 32137.0,
      "step": 3861,
      "turn_loss": 0.1131281778216362,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.17942761568481694,
      "grad_norm": 0.4440619647502899,
      "learning_rate": 7.74644009633088e-06,
      "loss": 0.105,
      "mae_dtheta": 0.008387042209506035,
      "mae_dx": 0.0021529204677790403,
      "mae_dy": 0.001306426478549838,
      "pose_mae_dtheta": 0.0597662553191185,
      "pose_mae_dx": 0.018219854682683945,
      "pose_mae_dy": 0.01856677047908306,
      "pose_rmse_dtheta": 0.18948954343795776,
      "pose_rmse_dx": 0.059304047375917435,
      "pose_rmse_dy": 0.07360372692346573,
      "pose_rmse_mean": 0.10746577382087708,
      "rmse_dtheta": 0.024274853989481926,
      "rmse_dx": 0.008646950125694275,
      "rmse_dy": 0.004358492325991392,
      "rmse_mean": 0.012426766566932201,
      "rotation_flip": 0.0035005833487957716,
      "sparse_tokens": 32105.0,
      "step": 3862,
      "turn_loss": 0.09432137757539749,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22972.0,
      "epoch": 0.17947407545065974,
      "grad_norm": 0.4886399507522583,
      "learning_rate": 7.7453351102477e-06,
      "loss": 0.1869,
      "mae_dtheta": 0.03482826054096222,
      "mae_dx": 0.012595809064805508,
      "mae_dy": 0.005385450553148985,
      "pose_mae_dtheta": 0.26697418093681335,
      "pose_mae_dx": 0.0932132825255394,
      "pose_mae_dy": 0.08036097884178162,
      "pose_rmse_dtheta": 0.4809761941432953,
      "pose_rmse_dx": 0.19834522902965546,
      "pose_rmse_dy": 0.18013326823711395,
      "pose_rmse_mean": 0.28648489713668823,
      "rmse_dtheta": 0.053807828575372696,
      "rmse_dx": 0.025410443544387817,
      "rmse_dy": 0.00953555665910244,
      "rmse_mean": 0.0295846089720726,
      "rotation_flip": 0.00939849577844143,
      "sparse_tokens": 18068.0,
      "step": 3863,
      "turn_loss": 0.25676780939102173,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.17952053521650252,
      "grad_norm": 0.35750308632850647,
      "learning_rate": 7.744229932181761e-06,
      "loss": 0.0869,
      "mae_dtheta": 0.008346982300281525,
      "mae_dx": 0.002560435328632593,
      "mae_dy": 0.002466274658218026,
      "pose_mae_dtheta": 0.057380665093660355,
      "pose_mae_dx": 0.025511622428894043,
      "pose_mae_dy": 0.021285565569996834,
      "pose_rmse_dtheta": 0.14451685547828674,
      "pose_rmse_dx": 0.07083801925182343,
      "pose_rmse_dy": 0.054622601717710495,
      "pose_rmse_mean": 0.08999249339103699,
      "rmse_dtheta": 0.020823907107114792,
      "rmse_dx": 0.0077718934044241905,
      "rmse_dy": 0.00600215932354331,
      "rmse_mean": 0.011532653123140335,
      "rotation_flip": 0.008580008521676064,
      "sparse_tokens": 32121.0,
      "step": 3864,
      "turn_loss": 0.07072717696428299,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.1795669949823453,
      "grad_norm": 0.7052839398384094,
      "learning_rate": 7.743124562210351e-06,
      "loss": 0.2068,
      "mae_dtheta": 0.03234989568591118,
      "mae_dx": 0.011342041194438934,
      "mae_dy": 0.008067825809121132,
      "pose_mae_dtheta": 0.24472366273403168,
      "pose_mae_dx": 0.10403191298246384,
      "pose_mae_dy": 0.10427889227867126,
      "pose_rmse_dtheta": 0.39247992634773254,
      "pose_rmse_dx": 0.21217899024486542,
      "pose_rmse_dy": 0.20927965641021729,
      "pose_rmse_mean": 0.2713128626346588,
      "rmse_dtheta": 0.04710567742586136,
      "rmse_dx": 0.02281966805458069,
      "rmse_dy": 0.013991106301546097,
      "rmse_mean": 0.027972152456641197,
      "rotation_flip": 0.017147310078144073,
      "sparse_tokens": 22084.0,
      "step": 3865,
      "turn_loss": 0.32154756784439087,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.17961345474818807,
      "grad_norm": 0.7234874963760376,
      "learning_rate": 7.742019000410767e-06,
      "loss": 0.1859,
      "mae_dtheta": 0.040980320423841476,
      "mae_dx": 0.015153140760958195,
      "mae_dy": 0.0073179816827178,
      "pose_mae_dtheta": 0.3411094844341278,
      "pose_mae_dx": 0.12596648931503296,
      "pose_mae_dy": 0.08710885047912598,
      "pose_rmse_dtheta": 0.5356053709983826,
      "pose_rmse_dx": 0.2515473961830139,
      "pose_rmse_dy": 0.1911781281232834,
      "pose_rmse_mean": 0.326110303401947,
      "rmse_dtheta": 0.058532871305942535,
      "rmse_dx": 0.028697514906525612,
      "rmse_dy": 0.014587108977138996,
      "rmse_mean": 0.033939167857170105,
      "rotation_flip": 0.016491753980517387,
      "sparse_tokens": 10822.0,
      "step": 3866,
      "turn_loss": 0.3985174596309662,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.17965991451403085,
      "grad_norm": 0.6031951308250427,
      "learning_rate": 7.740913246860322e-06,
      "loss": 0.1371,
      "mae_dtheta": 0.03364695981144905,
      "mae_dx": 0.011500895954668522,
      "mae_dy": 0.004158378578722477,
      "pose_mae_dtheta": 0.26678672432899475,
      "pose_mae_dx": 0.09204297512769699,
      "pose_mae_dy": 0.0429479144513607,
      "pose_rmse_dtheta": 0.46083566546440125,
      "pose_rmse_dx": 0.19662867486476898,
      "pose_rmse_dy": 0.10334381461143494,
      "pose_rmse_mean": 0.2536027133464813,
      "rmse_dtheta": 0.048633743077516556,
      "rmse_dx": 0.02228003367781639,
      "rmse_dy": 0.00859606172889471,
      "rmse_mean": 0.02650327980518341,
      "rotation_flip": 0.020249221473932266,
      "sparse_tokens": 11519.0,
      "step": 3867,
      "turn_loss": 0.23697812855243683,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.17970637427987363,
      "grad_norm": 0.5648069977760315,
      "learning_rate": 7.739807301636345e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.011512652970850468,
      "mae_dx": 0.0024303419049829245,
      "mae_dy": 0.002939006546512246,
      "pose_mae_dtheta": 0.07475359737873077,
      "pose_mae_dx": 0.02688225544989109,
      "pose_mae_dy": 0.031257808208465576,
      "pose_rmse_dtheta": 0.15478913486003876,
      "pose_rmse_dx": 0.06252705305814743,
      "pose_rmse_dy": 0.07636013627052307,
      "pose_rmse_mean": 0.09789210557937622,
      "rmse_dtheta": 0.0220491960644722,
      "rmse_dx": 0.006871107965707779,
      "rmse_dy": 0.007358628325164318,
      "rmse_mean": 0.01209297776222229,
      "rotation_flip": 0.0073048826307058334,
      "sparse_tokens": 32137.0,
      "step": 3868,
      "turn_loss": 0.10474159568548203,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.1797528340457164,
      "grad_norm": 1.0051809549331665,
      "learning_rate": 7.738701164816171e-06,
      "loss": 0.25,
      "mae_dtheta": 0.03408094868063927,
      "mae_dx": 0.003885832382366061,
      "mae_dy": 0.005131283774971962,
      "pose_mae_dtheta": 0.26203057169914246,
      "pose_mae_dx": 0.05128388851881027,
      "pose_mae_dy": 0.06618198752403259,
      "pose_rmse_dtheta": 0.5135715007781982,
      "pose_rmse_dx": 0.11346602439880371,
      "pose_rmse_dy": 0.13625329732894897,
      "pose_rmse_mean": 0.25443029403686523,
      "rmse_dtheta": 0.054591819643974304,
      "rmse_dx": 0.011501003056764603,
      "rmse_dy": 0.009261706843972206,
      "rmse_mean": 0.025118175894021988,
      "rotation_flip": 0.024436090141534805,
      "sparse_tokens": 9611.0,
      "step": 3869,
      "turn_loss": 0.17680887877941132,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.17979929381155918,
      "grad_norm": 0.535925567150116,
      "learning_rate": 7.737594836477155e-06,
      "loss": 0.152,
      "mae_dtheta": 0.021848324686288834,
      "mae_dx": 0.0063230418600142,
      "mae_dy": 0.003624988254159689,
      "pose_mae_dtheta": 0.15023916959762573,
      "pose_mae_dx": 0.05180882290005684,
      "pose_mae_dy": 0.03484693914651871,
      "pose_rmse_dtheta": 0.2790006995201111,
      "pose_rmse_dx": 0.12584321200847626,
      "pose_rmse_dy": 0.09105238318443298,
      "pose_rmse_mean": 0.16529877483844757,
      "rmse_dtheta": 0.03754094988107681,
      "rmse_dx": 0.015408738516271114,
      "rmse_dy": 0.007795834913849831,
      "rmse_mean": 0.02024850808084011,
      "rotation_flip": 0.011437908746302128,
      "sparse_tokens": 10696.0,
      "step": 3870,
      "turn_loss": 0.17586363852024078,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.17984575357740196,
      "grad_norm": 0.47937658429145813,
      "learning_rate": 7.736488316696663e-06,
      "loss": 0.1409,
      "mae_dtheta": 0.009701678529381752,
      "mae_dx": 0.0014193911338225007,
      "mae_dy": 0.0016078910557553172,
      "pose_mae_dtheta": 0.0669165626168251,
      "pose_mae_dx": 0.01615249551832676,
      "pose_mae_dy": 0.02235533855855465,
      "pose_rmse_dtheta": 0.20210658013820648,
      "pose_rmse_dx": 0.03729619085788727,
      "pose_rmse_dy": 0.0598704032599926,
      "pose_rmse_mean": 0.09975772351026535,
      "rmse_dtheta": 0.025289032608270645,
      "rmse_dx": 0.0037907669320702553,
      "rmse_dy": 0.00352810462936759,
      "rmse_mean": 0.010869300924241543,
      "rotation_flip": 0.0030514386016875505,
      "sparse_tokens": 32137.0,
      "step": 3871,
      "turn_loss": 0.08291487395763397,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.17989221334324476,
      "grad_norm": 0.6259210109710693,
      "learning_rate": 7.735381605552072e-06,
      "loss": 0.1323,
      "mae_dtheta": 0.015155209228396416,
      "mae_dx": 0.002820706693455577,
      "mae_dy": 0.004571753088384867,
      "pose_mae_dtheta": 0.1018751785159111,
      "pose_mae_dx": 0.028985703364014626,
      "pose_mae_dy": 0.05515904352068901,
      "pose_rmse_dtheta": 0.24644233286380768,
      "pose_rmse_dx": 0.06402000039815903,
      "pose_rmse_dy": 0.16033850610256195,
      "pose_rmse_mean": 0.15693360567092896,
      "rmse_dtheta": 0.031654562801122665,
      "rmse_dx": 0.009498709812760353,
      "rmse_dy": 0.013745777308940887,
      "rmse_mean": 0.018299683928489685,
      "rotation_flip": 0.009509319439530373,
      "sparse_tokens": 32089.0,
      "step": 3872,
      "turn_loss": 0.17354007065296173,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28139.0,
      "epoch": 0.17993867310908754,
      "grad_norm": 0.9743176698684692,
      "learning_rate": 7.73427470312078e-06,
      "loss": 0.3122,
      "mae_dtheta": 0.035893604159355164,
      "mae_dx": 0.01150699146091938,
      "mae_dy": 0.006624199915677309,
      "pose_mae_dtheta": 0.29312241077423096,
      "pose_mae_dx": 0.09167373180389404,
      "pose_mae_dy": 0.06326927244663239,
      "pose_rmse_dtheta": 0.47681793570518494,
      "pose_rmse_dx": 0.2086775302886963,
      "pose_rmse_dy": 0.17096394300460815,
      "pose_rmse_mean": 0.28548648953437805,
      "rmse_dtheta": 0.05395670235157013,
      "rmse_dx": 0.023197224363684654,
      "rmse_dy": 0.015647413209080696,
      "rmse_mean": 0.03093378059566021,
      "rotation_flip": 0.01807228848338127,
      "sparse_tokens": 21104.0,
      "step": 3873,
      "turn_loss": 0.31253117322921753,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.17998513287493031,
      "grad_norm": 0.6046489477157593,
      "learning_rate": 7.73316760948019e-06,
      "loss": 0.1814,
      "mae_dtheta": 0.0521988607943058,
      "mae_dx": 0.01985660381615162,
      "mae_dy": 0.013465745374560356,
      "pose_mae_dtheta": 0.41150662302970886,
      "pose_mae_dx": 0.1776030957698822,
      "pose_mae_dy": 0.11789120733737946,
      "pose_rmse_dtheta": 0.6233647465705872,
      "pose_rmse_dx": 0.3233875334262848,
      "pose_rmse_dy": 0.19189853966236115,
      "pose_rmse_mean": 0.3795503079891205,
      "rmse_dtheta": 0.06913824379444122,
      "rmse_dx": 0.03291679173707962,
      "rmse_dy": 0.021841395646333694,
      "rmse_mean": 0.04129881411790848,
      "rotation_flip": 0.006535947788506746,
      "sparse_tokens": 4827.0,
      "step": 3874,
      "turn_loss": 0.6096034646034241,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1800315926407731,
      "grad_norm": 0.754200279712677,
      "learning_rate": 7.732060324707721e-06,
      "loss": 0.1549,
      "mae_dtheta": 0.013469128869473934,
      "mae_dx": 0.0019494157750159502,
      "mae_dy": 0.003002114361152053,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.754200279712677,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.32876586914062,
      "model/head/act_norm_mean": 108.62428977272727,
      "model/head/act_norm_min": 62.17288589477539,
      "model/head/act_over_embed": 74.64762888844145,
      "model/head/grad_frac": 0.10683844238519669,
      "model/head/grad_norm": 0.08057758212089539,
      "model/head/grad_zero_frac": 0.00018972851103171706,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6954456676136364,
      "model/head/update_ratio": 0.0013854101998731494,
      "model/head/weight_delta": 7.351263523101807,
      "model/head/weight_delta_rel": 0.1289629340171814,
      "model/head/weight_norm": 58.16153335571289,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4172860085964203,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41721217407773964,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41714200377464294,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28671211202813646,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06924173980951309,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05222214013338089,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5501418862107623,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016917666653171182,
      "model/modality_embedder.encoders.pose/weight_delta": 2.4092845916748047,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07871883362531662,
      "model/modality_embedder.encoders.pose/weight_norm": 30.868406295776367,
      "model/modality_embedder/grad_frac": 0.06924173980951309,
      "model/modality_embedder/grad_norm": 0.05222214013338089,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5501418862107623,
      "model/modality_embedder/update_ratio": 0.0016917666653171182,
      "model/modality_embedder/weight_delta": 2.4092845916748047,
      "model/modality_embedder/weight_delta_rel": 0.07871883362531662,
      "model/modality_embedder/weight_norm": 30.868406295776367,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.04666137695312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.432760141093475,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.106893539428711,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.10321214991628,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0829010084271431,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06252396106719971,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0022539040073752403,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.7096599340438843,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.062301039695739746,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.740293502807617,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.91365814208984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.45603605499439,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.38624095916748,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.80641693800903,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08818835020065308,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06651167571544647,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.00226207310333848,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.1590676307678223,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0747917890548706,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.402973175048828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.53619384765625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.370034672118006,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.75334644317627,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.121734706833756,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0930398553609848,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07017068564891815,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0023117212112993,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.3155362606048584,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07775137573480606,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.35430145263672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.37667846679688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.259667608625943,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.437983512878418,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.420308151824287,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10403608530759811,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07846404612064362,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0026444995310157537,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.9771465063095093,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06756948679685593,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.6706600189209,
      "model/normalizer/grad_frac": 0.3832715153694153,
      "model/normalizer/grad_norm": 0.2890634834766388,
      "model/normalizer/grad_zero_frac": 0.00012762774713337421,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0036942861042916775,
      "model/normalizer/weight_delta": 4.20164680480957,
      "model/normalizer/weight_delta_rel": 0.054114777594804764,
      "model/normalizer/weight_norm": 78.24610137939453,
      "pose_mae_dtheta": 0.09426368027925491,
      "pose_mae_dx": 0.025999415665864944,
      "pose_mae_dy": 0.03456007316708565,
      "pose_rmse_dtheta": 0.23464450240135193,
      "pose_rmse_dx": 0.06513716280460358,
      "pose_rmse_dy": 0.08032021671533585,
      "pose_rmse_mean": 0.12670063972473145,
      "rmse_dtheta": 0.028693001717329025,
      "rmse_dx": 0.005692071747034788,
      "rmse_dy": 0.006568199954926968,
      "rmse_mean": 0.013651091605424881,
      "rotation_flip": 0.007467752788215876,
      "sparse_tokens": 32105.0,
      "step": 3875,
      "turn_loss": 0.10451667755842209,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.18007805240661587,
      "grad_norm": 0.4715229570865631,
      "learning_rate": 7.730952848880809e-06,
      "loss": 0.0983,
      "mae_dtheta": 0.036975882947444916,
      "mae_dx": 0.009861580096185207,
      "mae_dy": 0.004007712937891483,
      "pose_mae_dtheta": 0.27586716413497925,
      "pose_mae_dx": 0.06911762058734894,
      "pose_mae_dy": 0.04490607976913452,
      "pose_rmse_dtheta": 0.5172097682952881,
      "pose_rmse_dx": 0.1514609456062317,
      "pose_rmse_dy": 0.12031597644090652,
      "pose_rmse_mean": 0.26299557089805603,
      "rmse_dtheta": 0.057645101100206375,
      "rmse_dx": 0.02046646922826767,
      "rmse_dy": 0.007700264919549227,
      "rmse_mean": 0.028603946790099144,
      "rotation_flip": 0.01220752764493227,
      "sparse_tokens": 17167.0,
      "step": 3876,
      "turn_loss": 0.25801771879196167,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18012451217245865,
      "grad_norm": 0.42052161693573,
      "learning_rate": 7.729845182076896e-06,
      "loss": 0.0863,
      "mae_dtheta": 0.010162858292460442,
      "mae_dx": 0.0020027717109769583,
      "mae_dy": 0.0027429137844592333,
      "pose_mae_dtheta": 0.06652524322271347,
      "pose_mae_dx": 0.026187989860773087,
      "pose_mae_dy": 0.030488047748804092,
      "pose_rmse_dtheta": 0.17739471793174744,
      "pose_rmse_dx": 0.10447409749031067,
      "pose_rmse_dy": 0.06984938681125641,
      "pose_rmse_mean": 0.11723940074443817,
      "rmse_dtheta": 0.022648479789495468,
      "rmse_dx": 0.007646095007658005,
      "rmse_dy": 0.007176519371569157,
      "rmse_mean": 0.012490364722907543,
      "rotation_flip": 0.00575221236795187,
      "sparse_tokens": 32057.0,
      "step": 3877,
      "turn_loss": 0.08023331314325333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.18017097193830142,
      "grad_norm": 0.4864071011543274,
      "learning_rate": 7.728737324373445e-06,
      "loss": 0.1258,
      "mae_dtheta": 0.039399486035108566,
      "mae_dx": 0.011166217736899853,
      "mae_dy": 0.0029881992377340794,
      "pose_mae_dtheta": 0.31853148341178894,
      "pose_mae_dx": 0.08817252516746521,
      "pose_mae_dy": 0.026349933817982674,
      "pose_rmse_dtheta": 0.5733417272567749,
      "pose_rmse_dx": 0.18770311772823334,
      "pose_rmse_dy": 0.06758088618516922,
      "pose_rmse_mean": 0.2762085795402527,
      "rmse_dtheta": 0.06096247211098671,
      "rmse_dx": 0.02236468531191349,
      "rmse_dy": 0.005393106956034899,
      "rmse_mean": 0.02957342378795147,
      "rotation_flip": 0.018903592601418495,
      "sparse_tokens": 8973.0,
      "step": 3878,
      "turn_loss": 0.2217496782541275,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.1802174317041442,
      "grad_norm": 0.45121774077415466,
      "learning_rate": 7.72762927584793e-06,
      "loss": 0.133,
      "mae_dtheta": 0.029306132346391678,
      "mae_dx": 0.015676049515604973,
      "mae_dy": 0.0054701524786651134,
      "pose_mae_dtheta": 0.21033483743667603,
      "pose_mae_dx": 0.11627228558063507,
      "pose_mae_dy": 0.09356536716222763,
      "pose_rmse_dtheta": 0.3217233717441559,
      "pose_rmse_dx": 0.23987965285778046,
      "pose_rmse_dy": 0.2063101977109909,
      "pose_rmse_mean": 0.2559710741043091,
      "rmse_dtheta": 0.045983828604221344,
      "rmse_dx": 0.029846303164958954,
      "rmse_dy": 0.009178279899060726,
      "rmse_mean": 0.028336137533187866,
      "rotation_flip": 0.009433962404727936,
      "sparse_tokens": 7705.0,
      "step": 3879,
      "turn_loss": 0.23732562363147736,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.180263891469987,
      "grad_norm": 0.41975700855255127,
      "learning_rate": 7.726521036577834e-06,
      "loss": 0.0939,
      "mae_dtheta": 0.01347839180380106,
      "mae_dx": 0.00228617200627923,
      "mae_dy": 0.0034992715809494257,
      "pose_mae_dtheta": 0.09661256521940231,
      "pose_mae_dx": 0.03078068234026432,
      "pose_mae_dy": 0.04146796092391014,
      "pose_rmse_dtheta": 0.2317000776529312,
      "pose_rmse_dx": 0.07934432476758957,
      "pose_rmse_dy": 0.11076802760362625,
      "pose_rmse_mean": 0.1406041383743286,
      "rmse_dtheta": 0.02712790109217167,
      "rmse_dx": 0.006436062511056662,
      "rmse_dy": 0.007538774982094765,
      "rmse_mean": 0.013700912706553936,
      "rotation_flip": 0.008702232502400875,
      "sparse_tokens": 32073.0,
      "step": 3880,
      "turn_loss": 0.12003034353256226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18031035123582978,
      "grad_norm": 1.0090305805206299,
      "learning_rate": 7.725412606640658e-06,
      "loss": 0.2034,
      "mae_dtheta": 0.013525361195206642,
      "mae_dx": 0.002924524247646332,
      "mae_dy": 0.0034501508343964815,
      "pose_mae_dtheta": 0.08725304901599884,
      "pose_mae_dx": 0.033238835632801056,
      "pose_mae_dy": 0.03700704127550125,
      "pose_rmse_dtheta": 0.1969660222530365,
      "pose_rmse_dx": 0.09215129911899567,
      "pose_rmse_dy": 0.0838470458984375,
      "pose_rmse_mean": 0.12432146072387695,
      "rmse_dtheta": 0.026580998674035072,
      "rmse_dx": 0.009722325019538403,
      "rmse_dy": 0.008756760507822037,
      "rmse_mean": 0.015020027756690979,
      "rotation_flip": 0.0071428571827709675,
      "sparse_tokens": 32057.0,
      "step": 3881,
      "turn_loss": 0.12250890582799911,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.18035681100167256,
      "grad_norm": 0.33327212929725647,
      "learning_rate": 7.724303986113917e-06,
      "loss": 0.0714,
      "mae_dtheta": 0.009862684644758701,
      "mae_dx": 0.0018390361219644547,
      "mae_dy": 0.0016266886377707124,
      "pose_mae_dtheta": 0.06607258319854736,
      "pose_mae_dx": 0.01859666034579277,
      "pose_mae_dy": 0.021049460396170616,
      "pose_rmse_dtheta": 0.1508598029613495,
      "pose_rmse_dx": 0.047960083931684494,
      "pose_rmse_dy": 0.04428332298994064,
      "pose_rmse_mean": 0.08103440701961517,
      "rmse_dtheta": 0.022346429526805878,
      "rmse_dx": 0.005371714010834694,
      "rmse_dy": 0.0031996164470911026,
      "rmse_mean": 0.010305920615792274,
      "rotation_flip": 0.0037678976077586412,
      "sparse_tokens": 32185.0,
      "step": 3882,
      "turn_loss": 0.07227330654859543,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.18040327076751533,
      "grad_norm": 0.58225017786026,
      "learning_rate": 7.723195175075136e-06,
      "loss": 0.1418,
      "mae_dtheta": 0.038157206028699875,
      "mae_dx": 0.014593381434679031,
      "mae_dy": 0.006341514177620411,
      "pose_mae_dtheta": 0.31900128722190857,
      "pose_mae_dx": 0.09799472242593765,
      "pose_mae_dy": 0.08338962495326996,
      "pose_rmse_dtheta": 0.5595725774765015,
      "pose_rmse_dx": 0.2065943330526352,
      "pose_rmse_dy": 0.2226317971944809,
      "pose_rmse_mean": 0.3295995891094208,
      "rmse_dtheta": 0.058888040482997894,
      "rmse_dx": 0.0267935860902071,
      "rmse_dy": 0.015501615591347218,
      "rmse_mean": 0.033727750182151794,
      "rotation_flip": 0.009695290587842464,
      "sparse_tokens": 12545.0,
      "step": 3883,
      "turn_loss": 0.3453383147716522,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.1804497305333581,
      "grad_norm": 0.4300094544887543,
      "learning_rate": 7.722086173601854e-06,
      "loss": 0.1345,
      "mae_dtheta": 0.028121940791606903,
      "mae_dx": 0.009854236617684364,
      "mae_dy": 0.004629773087799549,
      "pose_mae_dtheta": 0.19215230643749237,
      "pose_mae_dx": 0.07370734959840775,
      "pose_mae_dy": 0.05290517583489418,
      "pose_rmse_dtheta": 0.3818276524543762,
      "pose_rmse_dx": 0.17530357837677002,
      "pose_rmse_dy": 0.139295294880867,
      "pose_rmse_mean": 0.23214218020439148,
      "rmse_dtheta": 0.046286094933748245,
      "rmse_dx": 0.021229149773716927,
      "rmse_dy": 0.010758303105831146,
      "rmse_mean": 0.026091184467077255,
      "rotation_flip": 0.011935208924114704,
      "sparse_tokens": 19943.0,
      "step": 3884,
      "turn_loss": 0.2584262490272522,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1804961902992009,
      "grad_norm": 0.7998090386390686,
      "learning_rate": 7.720976981771626e-06,
      "loss": 0.1155,
      "mae_dtheta": 0.013635274022817612,
      "mae_dx": 0.002338412683457136,
      "mae_dy": 0.0029078808147460222,
      "pose_mae_dtheta": 0.08489526063203812,
      "pose_mae_dx": 0.02560376562178135,
      "pose_mae_dy": 0.03308824449777603,
      "pose_rmse_dtheta": 0.16279879212379456,
      "pose_rmse_dx": 0.05799451842904091,
      "pose_rmse_dy": 0.07892631739377975,
      "pose_rmse_mean": 0.0999065488576889,
      "rmse_dtheta": 0.025497954338788986,
      "rmse_dx": 0.0068464758805930614,
      "rmse_dy": 0.006511526182293892,
      "rmse_mean": 0.012951985001564026,
      "rotation_flip": 0.0041244844906032085,
      "sparse_tokens": 32105.0,
      "step": 3885,
      "turn_loss": 0.11738156527280807,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.18054265006504366,
      "grad_norm": 0.5039592981338501,
      "learning_rate": 7.719867599662017e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.0347699336707592,
      "mae_dx": 0.014498802833259106,
      "mae_dy": 0.005700078792870045,
      "pose_mae_dtheta": 0.25233444571495056,
      "pose_mae_dx": 0.11120674014091492,
      "pose_mae_dy": 0.08254897594451904,
      "pose_rmse_dtheta": 0.4769800305366516,
      "pose_rmse_dx": 0.22862431406974792,
      "pose_rmse_dy": 0.1573546677827835,
      "pose_rmse_mean": 0.28765299916267395,
      "rmse_dtheta": 0.05377904325723648,
      "rmse_dx": 0.027869917452335358,
      "rmse_dy": 0.009491687640547752,
      "rmse_mean": 0.030380217358469963,
      "rotation_flip": 0.007281553465873003,
      "sparse_tokens": 8002.0,
      "step": 3886,
      "turn_loss": 0.26647475361824036,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.18058910983088644,
      "grad_norm": 0.38377687335014343,
      "learning_rate": 7.718758027350606e-06,
      "loss": 0.1103,
      "mae_dtheta": 0.009741878136992455,
      "mae_dx": 0.0016253519570454955,
      "mae_dy": 0.0022803377360105515,
      "pose_mae_dtheta": 0.06350317597389221,
      "pose_mae_dx": 0.020806267857551575,
      "pose_mae_dy": 0.027901774272322655,
      "pose_rmse_dtheta": 0.14060382544994354,
      "pose_rmse_dx": 0.05205569788813591,
      "pose_rmse_dy": 0.06788953393697739,
      "pose_rmse_mean": 0.08684968948364258,
      "rmse_dtheta": 0.019474515691399574,
      "rmse_dx": 0.004796069581061602,
      "rmse_dy": 0.0050642648711800575,
      "rmse_mean": 0.009778283536434174,
      "rotation_flip": 0.004928131587803364,
      "sparse_tokens": 32105.0,
      "step": 3887,
      "turn_loss": 0.07806172221899033,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27172.0,
      "epoch": 0.18063556959672925,
      "grad_norm": 0.4165289103984833,
      "learning_rate": 7.717648264914987e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.036607157438993454,
      "mae_dx": 0.012345002964138985,
      "mae_dy": 0.004580519162118435,
      "pose_mae_dtheta": 0.30482229590415955,
      "pose_mae_dx": 0.09168961644172668,
      "pose_mae_dy": 0.06393678486347198,
      "pose_rmse_dtheta": 0.5703668594360352,
      "pose_rmse_dx": 0.21251295506954193,
      "pose_rmse_dy": 0.1545136719942093,
      "pose_rmse_mean": 0.31246450543403625,
      "rmse_dtheta": 0.05728618800640106,
      "rmse_dx": 0.024981796741485596,
      "rmse_dy": 0.009281211532652378,
      "rmse_mean": 0.030516399070620537,
      "rotation_flip": 0.014470677822828293,
      "sparse_tokens": 22047.0,
      "step": 3888,
      "turn_loss": 0.2365645468235016,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.18068202936257202,
      "grad_norm": 0.6477325558662415,
      "learning_rate": 7.716538312432767e-06,
      "loss": 0.212,
      "mae_dtheta": 0.03430737182497978,
      "mae_dx": 0.010322203859686852,
      "mae_dy": 0.006964086089283228,
      "pose_mae_dtheta": 0.2660520076751709,
      "pose_mae_dx": 0.08848147094249725,
      "pose_mae_dy": 0.09178003668785095,
      "pose_rmse_dtheta": 0.4639807939529419,
      "pose_rmse_dx": 0.1841183751821518,
      "pose_rmse_dy": 0.20897656679153442,
      "pose_rmse_mean": 0.28569191694259644,
      "rmse_dtheta": 0.051666632294654846,
      "rmse_dx": 0.022186437621712685,
      "rmse_dy": 0.012470858171582222,
      "rmse_mean": 0.028774641454219818,
      "rotation_flip": 0.011904762126505375,
      "sparse_tokens": 17338.0,
      "step": 3889,
      "turn_loss": 0.29670536518096924,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1807284891284148,
      "grad_norm": 0.4466168284416199,
      "learning_rate": 7.715428169981563e-06,
      "loss": 0.0942,
      "mae_dtheta": 0.009854993782937527,
      "mae_dx": 0.0013298038393259048,
      "mae_dy": 0.0019749265629798174,
      "pose_mae_dtheta": 0.06315375119447708,
      "pose_mae_dx": 0.01658499985933304,
      "pose_mae_dy": 0.028329653665423393,
      "pose_rmse_dtheta": 0.15722261369228363,
      "pose_rmse_dx": 0.044994521886110306,
      "pose_rmse_dy": 0.06278001517057419,
      "pose_rmse_mean": 0.08833238482475281,
      "rmse_dtheta": 0.020388059318065643,
      "rmse_dx": 0.004678047727793455,
      "rmse_dy": 0.00415942445397377,
      "rmse_mean": 0.009741844609379768,
      "rotation_flip": 0.001215559197589755,
      "sparse_tokens": 32073.0,
      "step": 3890,
      "turn_loss": 0.08977928757667542,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.18077494889425758,
      "grad_norm": 0.5168419480323792,
      "learning_rate": 7.714317837639011e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.03336665406823158,
      "mae_dx": 0.012051348574459553,
      "mae_dy": 0.0041196709498763084,
      "pose_mae_dtheta": 0.27051109075546265,
      "pose_mae_dx": 0.09333117306232452,
      "pose_mae_dy": 0.06078712269663811,
      "pose_rmse_dtheta": 0.48085498809814453,
      "pose_rmse_dx": 0.21802756190299988,
      "pose_rmse_dy": 0.13319191336631775,
      "pose_rmse_mean": 0.27735817432403564,
      "rmse_dtheta": 0.051624033600091934,
      "rmse_dx": 0.02529766596853733,
      "rmse_dy": 0.0081967543810606,
      "rmse_mean": 0.02837282046675682,
      "rotation_flip": 0.020255863666534424,
      "sparse_tokens": 16626.0,
      "step": 3891,
      "turn_loss": 0.2396654486656189,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.18082140866010035,
      "grad_norm": 0.6097905039787292,
      "learning_rate": 7.713207315482756e-06,
      "loss": 0.1148,
      "mae_dtheta": 0.03660381957888603,
      "mae_dx": 0.007487331051379442,
      "mae_dy": 0.0037805999163538218,
      "pose_mae_dtheta": 0.30146199464797974,
      "pose_mae_dx": 0.055997345596551895,
      "pose_mae_dy": 0.048151567578315735,
      "pose_rmse_dtheta": 0.549278736114502,
      "pose_rmse_dx": 0.1222853884100914,
      "pose_rmse_dy": 0.1213173046708107,
      "pose_rmse_mean": 0.2642938196659088,
      "rmse_dtheta": 0.05596387758851051,
      "rmse_dx": 0.0164466705173254,
      "rmse_dy": 0.006672929506748915,
      "rmse_mean": 0.02636115811765194,
      "rotation_flip": 0.008992806077003479,
      "sparse_tokens": 8825.0,
      "step": 3892,
      "turn_loss": 0.21869730949401855,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.18086786842594313,
      "grad_norm": 0.5546876192092896,
      "learning_rate": 7.712096603590455e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.006599126849323511,
      "mae_dx": 0.0013871713308617473,
      "mae_dy": 0.0009008998167701066,
      "pose_mae_dtheta": 0.048468995839357376,
      "pose_mae_dx": 0.014515571296215057,
      "pose_mae_dy": 0.014311027713119984,
      "pose_rmse_dtheta": 0.17258496582508087,
      "pose_rmse_dx": 0.04096300154924393,
      "pose_rmse_dy": 0.040501974523067474,
      "pose_rmse_mean": 0.08468332141637802,
      "rmse_dtheta": 0.019500916823744774,
      "rmse_dx": 0.0047242180444300175,
      "rmse_dy": 0.0021123564802110195,
      "rmse_mean": 0.008779164403676987,
      "rotation_flip": 0.0005130836507305503,
      "sparse_tokens": 32121.0,
      "step": 3893,
      "turn_loss": 0.04700044170022011,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1809143281917859,
      "grad_norm": 0.6787485480308533,
      "learning_rate": 7.710985702039786e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.006616813596338034,
      "mae_dx": 0.0013726248871535063,
      "mae_dy": 0.001120016211643815,
      "pose_mae_dtheta": 0.047790925949811935,
      "pose_mae_dx": 0.011399352923035622,
      "pose_mae_dy": 0.017136016860604286,
      "pose_rmse_dtheta": 0.14134597778320312,
      "pose_rmse_dx": 0.030205868184566498,
      "pose_rmse_dy": 0.04128504544496536,
      "pose_rmse_mean": 0.0709456354379654,
      "rmse_dtheta": 0.01804143190383911,
      "rmse_dx": 0.00439679529517889,
      "rmse_dy": 0.0023254931438714266,
      "rmse_mean": 0.008254574611783028,
      "rotation_flip": 0.0036764706019312143,
      "sparse_tokens": 32153.0,
      "step": 3894,
      "turn_loss": 0.04915018752217293,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33635.0,
      "epoch": 0.18096078795762868,
      "grad_norm": 0.454595685005188,
      "learning_rate": 7.70987461090843e-06,
      "loss": 0.1394,
      "mae_dtheta": 0.03967634215950966,
      "mae_dx": 0.0160419549793005,
      "mae_dy": 0.007959544658660889,
      "pose_mae_dtheta": 0.3087000548839569,
      "pose_mae_dx": 0.12721753120422363,
      "pose_mae_dy": 0.0868748277425766,
      "pose_rmse_dtheta": 0.5276039242744446,
      "pose_rmse_dx": 0.25721389055252075,
      "pose_rmse_dy": 0.21426258981227875,
      "pose_rmse_mean": 0.33302682638168335,
      "rmse_dtheta": 0.05823790282011032,
      "rmse_dx": 0.028560983017086983,
      "rmse_dy": 0.017673006281256676,
      "rmse_mean": 0.03482396528124809,
      "rotation_flip": 0.014102564193308353,
      "sparse_tokens": 27241.0,
      "step": 3895,
      "turn_loss": 0.3696017861366272,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.1810072477234715,
      "grad_norm": 0.6845598220825195,
      "learning_rate": 7.708763330274088e-06,
      "loss": 0.1386,
      "mae_dtheta": 0.027869807556271553,
      "mae_dx": 0.008428700268268585,
      "mae_dy": 0.0031212579924613237,
      "pose_mae_dtheta": 0.2317277044057846,
      "pose_mae_dx": 0.059909719973802567,
      "pose_mae_dy": 0.02560572884976864,
      "pose_rmse_dtheta": 0.4686010479927063,
      "pose_rmse_dx": 0.16281382739543915,
      "pose_rmse_dy": 0.07010379433631897,
      "pose_rmse_mean": 0.23383955657482147,
      "rmse_dtheta": 0.04996989667415619,
      "rmse_dx": 0.019322309643030167,
      "rmse_dy": 0.007608421146869659,
      "rmse_mean": 0.025633541867136955,
      "rotation_flip": 0.010507880710065365,
      "sparse_tokens": 11817.0,
      "step": 3896,
      "turn_loss": 0.18210718035697937,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.18105370748931426,
      "grad_norm": 0.5224646925926208,
      "learning_rate": 7.707651860214474e-06,
      "loss": 0.1287,
      "mae_dtheta": 0.029271526262164116,
      "mae_dx": 0.013229635544121265,
      "mae_dy": 0.005088095087558031,
      "pose_mae_dtheta": 0.1995982527732849,
      "pose_mae_dx": 0.09386477619409561,
      "pose_mae_dy": 0.05439106002449989,
      "pose_rmse_dtheta": 0.3609950542449951,
      "pose_rmse_dx": 0.2224683314561844,
      "pose_rmse_dy": 0.10784174501895905,
      "pose_rmse_mean": 0.23043504357337952,
      "rmse_dtheta": 0.043038029223680496,
      "rmse_dx": 0.026558605954051018,
      "rmse_dy": 0.009255215525627136,
      "rmse_mean": 0.026283949613571167,
      "rotation_flip": 0.024169184267520905,
      "sparse_tokens": 5675.0,
      "step": 3897,
      "turn_loss": 0.3080306649208069,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.18110016725515704,
      "grad_norm": 0.48269063234329224,
      "learning_rate": 7.70654020080731e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.008050160482525826,
      "mae_dx": 0.001443533576093614,
      "mae_dy": 0.0002760266943369061,
      "pose_mae_dtheta": 0.05509156733751297,
      "pose_mae_dx": 0.01149990689009428,
      "pose_mae_dy": 0.0035958129446953535,
      "pose_rmse_dtheta": 0.24253329634666443,
      "pose_rmse_dx": 0.027666108682751656,
      "pose_rmse_dy": 0.009904404170811176,
      "pose_rmse_mean": 0.09336794912815094,
      "rmse_dtheta": 0.03017980046570301,
      "rmse_dx": 0.0044123344123363495,
      "rmse_dy": 0.000781661132350564,
      "rmse_mean": 0.01179126650094986,
      "rotation_flip": 0.0011997600086033344,
      "sparse_tokens": 32217.0,
      "step": 3898,
      "turn_loss": 0.04486370086669922,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.18114662702099982,
      "grad_norm": 0.4426823854446411,
      "learning_rate": 7.705428352130337e-06,
      "loss": 0.1078,
      "mae_dtheta": 0.014722064137458801,
      "mae_dx": 0.003450260031968355,
      "mae_dy": 0.004218699410557747,
      "pose_mae_dtheta": 0.11067675799131393,
      "pose_mae_dx": 0.038988977670669556,
      "pose_mae_dy": 0.03946876525878906,
      "pose_rmse_dtheta": 0.2845073342323303,
      "pose_rmse_dx": 0.11298050731420517,
      "pose_rmse_dy": 0.10768681019544601,
      "pose_rmse_mean": 0.16839155554771423,
      "rmse_dtheta": 0.031378768384456635,
      "rmse_dx": 0.011334090493619442,
      "rmse_dy": 0.011131891049444675,
      "rmse_mean": 0.017948251217603683,
      "rotation_flip": 0.0036261079367250204,
      "sparse_tokens": 32105.0,
      "step": 3899,
      "turn_loss": 0.14048844575881958,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1811930867868426,
      "grad_norm": 0.4124700129032135,
      "learning_rate": 7.70431631426131e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.010695988312363625,
      "mae_dx": 0.0022686209995299578,
      "mae_dy": 0.0028921279590576887,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.41246986389160156,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.62806701660156,
      "model/head/act_norm_mean": 111.23311237373737,
      "model/head/act_norm_min": 61.39036178588867,
      "model/head/act_over_embed": 76.44043620403758,
      "model/head/grad_frac": 0.11238361895084381,
      "model/head/grad_norm": 0.046354856342077255,
      "model/head/grad_zero_frac": 0.00016434676945209503,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6909771543560606,
      "model/head/update_ratio": 0.0007969235884957016,
      "model/head/weight_delta": 7.37865686416626,
      "model/head/weight_delta_rel": 0.12944349646568298,
      "model/head/weight_norm": 58.16725540161133,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41740062832832336,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41733577913124653,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4172588586807251,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28679705457811516,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08394131064414978,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03462326154112816,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.533530079845815,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011216067941859365,
      "model/modality_embedder.encoders.pose/weight_delta": 2.4143195152282715,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0788833424448967,
      "model/modality_embedder.encoders.pose/weight_norm": 30.869340896606445,
      "model/modality_embedder/grad_frac": 0.08394131064414978,
      "model/modality_embedder/grad_norm": 0.03462326154112816,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.533530079845815,
      "model/modality_embedder/update_ratio": 0.0011216067941859365,
      "model/modality_embedder/weight_delta": 2.4143195152282715,
      "model/modality_embedder/weight_delta_rel": 0.0788833424448967,
      "model/modality_embedder/weight_norm": 30.869340896606445,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.9418716430664,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.753437149270482,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.003949165344238,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.32358439216097,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07666181772947311,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03162068873643875,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011398164788261056,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.7168586254119873,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06256336718797684,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.741912841796875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.30158996582031,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.81671877505211,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.480035781860352,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.054281479997524,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08103290945291519,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03342363238334656,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011366346152499318,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.1690516471862793,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07513764500617981,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.405784606933594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.28138732910156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.776868386243386,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.760848999023438,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.401314644017955,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0821799635887146,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.033896759152412415,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011165750911459327,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.3269975185394287,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07813622057437897,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.35779571533203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.03565979003906,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.63040373977874,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.600203514099121,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.67508149203883,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08227155357599258,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03393453732132912,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011436068452894688,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.9872496128082275,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06791476160287857,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.673255920410156,
      "model/normalizer/grad_frac": 0.276807576417923,
      "model/normalizer/grad_norm": 0.11417478322982788,
      "model/normalizer/grad_zero_frac": 0.0001571712055010721,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014591114595532417,
      "model/normalizer/weight_delta": 4.22168493270874,
      "model/normalizer/weight_delta_rel": 0.05437285825610161,
      "model/normalizer/weight_norm": 78.24952697753906,
      "pose_mae_dtheta": 0.07361175864934921,
      "pose_mae_dx": 0.027056876569986343,
      "pose_mae_dy": 0.024388544261455536,
      "pose_rmse_dtheta": 0.207314133644104,
      "pose_rmse_dx": 0.10409180819988251,
      "pose_rmse_dy": 0.05844402685761452,
      "pose_rmse_mean": 0.12328332662582397,
      "rmse_dtheta": 0.024503253400325775,
      "rmse_dx": 0.008958405815064907,
      "rmse_dy": 0.006818362511694431,
      "rmse_mean": 0.013426674529910088,
      "rotation_flip": 0.0022205773275345564,
      "sparse_tokens": 32137.0,
      "step": 3900,
      "turn_loss": 0.10205252468585968,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.18123954655268537,
      "grad_norm": 0.36466023325920105,
      "learning_rate": 7.703204087277989e-06,
      "loss": 0.0619,
      "mae_dtheta": 0.009432069957256317,
      "mae_dx": 0.0013154874322935939,
      "mae_dy": 0.0014006730634719133,
      "pose_mae_dtheta": 0.06533435732126236,
      "pose_mae_dx": 0.017824482172727585,
      "pose_mae_dy": 0.02005181834101677,
      "pose_rmse_dtheta": 0.20243702828884125,
      "pose_rmse_dx": 0.051361896097660065,
      "pose_rmse_dy": 0.051771070808172226,
      "pose_rmse_mean": 0.10185667127370834,
      "rmse_dtheta": 0.025555716827511787,
      "rmse_dx": 0.00503684114664793,
      "rmse_dy": 0.0029676356352865696,
      "rmse_mean": 0.011186731979250908,
      "rotation_flip": 0.001484413631260395,
      "sparse_tokens": 32041.0,
      "step": 3901,
      "turn_loss": 0.058245282620191574,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.18128600631852815,
      "grad_norm": 0.5316833257675171,
      "learning_rate": 7.702091671258156e-06,
      "loss": 0.1415,
      "mae_dtheta": 0.03343821316957474,
      "mae_dx": 0.012878143228590488,
      "mae_dy": 0.004762967582792044,
      "pose_mae_dtheta": 0.25730788707733154,
      "pose_mae_dx": 0.10661208629608154,
      "pose_mae_dy": 0.052347298711538315,
      "pose_rmse_dtheta": 0.4722040593624115,
      "pose_rmse_dx": 0.1899528056383133,
      "pose_rmse_dy": 0.1008315160870552,
      "pose_rmse_mean": 0.25432947278022766,
      "rmse_dtheta": 0.04927269369363785,
      "rmse_dx": 0.023218844085931778,
      "rmse_dy": 0.007939119823276997,
      "rmse_mean": 0.02681022137403488,
      "rotation_flip": 0.007843137718737125,
      "sparse_tokens": 8591.0,
      "step": 3902,
      "turn_loss": 0.29657718539237976,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.18133246608437092,
      "grad_norm": 0.48640185594558716,
      "learning_rate": 7.700979066279602e-06,
      "loss": 0.1265,
      "mae_dtheta": 0.010846806690096855,
      "mae_dx": 0.0022561154328286648,
      "mae_dy": 0.0018856250680983067,
      "pose_mae_dtheta": 0.07739628851413727,
      "pose_mae_dx": 0.02415110357105732,
      "pose_mae_dy": 0.029394928365945816,
      "pose_rmse_dtheta": 0.19653192162513733,
      "pose_rmse_dx": 0.06947579234838486,
      "pose_rmse_dy": 0.0744360014796257,
      "pose_rmse_mean": 0.11348124593496323,
      "rmse_dtheta": 0.02436346374452114,
      "rmse_dx": 0.007887917570769787,
      "rmse_dy": 0.004407287109643221,
      "rmse_mean": 0.012219555675983429,
      "rotation_flip": 0.00328137818723917,
      "sparse_tokens": 32105.0,
      "step": 3903,
      "turn_loss": 0.08602841943502426,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.1813789258502137,
      "grad_norm": 0.6028220653533936,
      "learning_rate": 7.699866272420132e-06,
      "loss": 0.1511,
      "mae_dtheta": 0.02488727867603302,
      "mae_dx": 0.012033301405608654,
      "mae_dy": 0.0034695486538112164,
      "pose_mae_dtheta": 0.1872781366109848,
      "pose_mae_dx": 0.09271644800901413,
      "pose_mae_dy": 0.045409005135297775,
      "pose_rmse_dtheta": 0.3814772665500641,
      "pose_rmse_dx": 0.2079600691795349,
      "pose_rmse_dy": 0.12567245960235596,
      "pose_rmse_mean": 0.23836994171142578,
      "rmse_dtheta": 0.044535502791404724,
      "rmse_dx": 0.025218013674020767,
      "rmse_dy": 0.007992565631866455,
      "rmse_mean": 0.0259153600782156,
      "rotation_flip": 0.0044843051582574844,
      "sparse_tokens": 13606.0,
      "step": 3904,
      "turn_loss": 0.1985463947057724,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.1814253856160565,
      "grad_norm": 0.46502789855003357,
      "learning_rate": 7.698753289757565e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.04132385551929474,
      "mae_dx": 0.012844367884099483,
      "mae_dy": 0.009138878434896469,
      "pose_mae_dtheta": 0.3278159499168396,
      "pose_mae_dx": 0.09088784456253052,
      "pose_mae_dy": 0.10464250296354294,
      "pose_rmse_dtheta": 0.532782793045044,
      "pose_rmse_dx": 0.20120970904827118,
      "pose_rmse_dy": 0.23465746641159058,
      "pose_rmse_mean": 0.32288333773612976,
      "rmse_dtheta": 0.05919327959418297,
      "rmse_dx": 0.024536198005080223,
      "rmse_dy": 0.01803257316350937,
      "rmse_mean": 0.03392068296670914,
      "rotation_flip": 0.012172284536063671,
      "sparse_tokens": 19177.0,
      "step": 3905,
      "turn_loss": 0.355183869600296,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.18147184538189928,
      "grad_norm": 0.5297496318817139,
      "learning_rate": 7.69764011836973e-06,
      "loss": 0.1686,
      "mae_dtheta": 0.044789642095565796,
      "mae_dx": 0.019123638048768044,
      "mae_dy": 0.012537541799247265,
      "pose_mae_dtheta": 0.3681880831718445,
      "pose_mae_dx": 0.12987852096557617,
      "pose_mae_dy": 0.13815470039844513,
      "pose_rmse_dtheta": 0.5703596472740173,
      "pose_rmse_dx": 0.251365602016449,
      "pose_rmse_dy": 0.33324211835861206,
      "pose_rmse_mean": 0.3849891126155853,
      "rmse_dtheta": 0.06408963352441788,
      "rmse_dx": 0.033476632088422775,
      "rmse_dy": 0.025481972843408585,
      "rmse_mean": 0.04101607948541641,
      "rotation_flip": 0.011695906519889832,
      "sparse_tokens": 5536.0,
      "step": 3906,
      "turn_loss": 0.5066297054290771,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18151830514774206,
      "grad_norm": 0.3791620433330536,
      "learning_rate": 7.696526758334477e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.008788147941231728,
      "mae_dx": 0.0019931772258132696,
      "mae_dy": 0.0018435056554153562,
      "pose_mae_dtheta": 0.06089959293603897,
      "pose_mae_dx": 0.021819021552801132,
      "pose_mae_dy": 0.020522726699709892,
      "pose_rmse_dtheta": 0.1679263561964035,
      "pose_rmse_dx": 0.06648045778274536,
      "pose_rmse_dy": 0.04885143041610718,
      "pose_rmse_mean": 0.09441941976547241,
      "rmse_dtheta": 0.023144736886024475,
      "rmse_dx": 0.006967480760067701,
      "rmse_dy": 0.004701591562479734,
      "rmse_mean": 0.011604603379964828,
      "rotation_flip": 0.004333172924816608,
      "sparse_tokens": 32089.0,
      "step": 3907,
      "turn_loss": 0.07544292509555817,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18156476491358484,
      "grad_norm": 0.8720570206642151,
      "learning_rate": 7.69541320972966e-06,
      "loss": 0.13,
      "mae_dtheta": 0.010949041694402695,
      "mae_dx": 0.004025715868920088,
      "mae_dy": 0.0016117073828354478,
      "pose_mae_dtheta": 0.08516459167003632,
      "pose_mae_dx": 0.035955049097537994,
      "pose_mae_dy": 0.024392468854784966,
      "pose_rmse_dtheta": 0.23082159459590912,
      "pose_rmse_dx": 0.11388629674911499,
      "pose_rmse_dy": 0.0772789865732193,
      "pose_rmse_mean": 0.1406622976064682,
      "rmse_dtheta": 0.026149466633796692,
      "rmse_dx": 0.012134470976889133,
      "rmse_dy": 0.0049644168466329575,
      "rmse_mean": 0.014416119083762169,
      "rotation_flip": 0.004098360426723957,
      "sparse_tokens": 32089.0,
      "step": 3908,
      "turn_loss": 0.09046026319265366,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.1816112246794276,
      "grad_norm": 0.5095372796058655,
      "learning_rate": 7.694299472633149e-06,
      "loss": 0.1232,
      "mae_dtheta": 0.03787583112716675,
      "mae_dx": 0.012987914495170116,
      "mae_dy": 0.008503908291459084,
      "pose_mae_dtheta": 0.28082534670829773,
      "pose_mae_dx": 0.11220745742321014,
      "pose_mae_dy": 0.09347887337207794,
      "pose_rmse_dtheta": 0.4624745845794678,
      "pose_rmse_dx": 0.23795931041240692,
      "pose_rmse_dy": 0.211471289396286,
      "pose_rmse_mean": 0.3039683997631073,
      "rmse_dtheta": 0.0552653893828392,
      "rmse_dx": 0.025406846776604652,
      "rmse_dy": 0.016142431646585464,
      "rmse_mean": 0.03227155655622482,
      "rotation_flip": 0.01909722201526165,
      "sparse_tokens": 18079.0,
      "step": 3909,
      "turn_loss": 0.3187063932418823,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1816576844452704,
      "grad_norm": 0.3014576733112335,
      "learning_rate": 7.69318554712283e-06,
      "loss": 0.0781,
      "mae_dtheta": 0.005655908025801182,
      "mae_dx": 0.0012662189546972513,
      "mae_dy": 0.0008792287553660572,
      "pose_mae_dtheta": 0.04447653144598007,
      "pose_mae_dx": 0.012786878272891045,
      "pose_mae_dy": 0.014050452038645744,
      "pose_rmse_dtheta": 0.1524549275636673,
      "pose_rmse_dx": 0.03649243339896202,
      "pose_rmse_dy": 0.038377031683921814,
      "pose_rmse_mean": 0.07577480375766754,
      "rmse_dtheta": 0.016809767112135887,
      "rmse_dx": 0.004675125703215599,
      "rmse_dy": 0.0020972732454538345,
      "rmse_mean": 0.00786072202026844,
      "rotation_flip": 0.005836575757712126,
      "sparse_tokens": 32105.0,
      "step": 3910,
      "turn_loss": 0.0372699536383152,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18170414421111317,
      "grad_norm": 0.4076852798461914,
      "learning_rate": 7.6920714332766e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.010847623459994793,
      "mae_dx": 0.0012281282106414437,
      "mae_dy": 0.0018220423953607678,
      "pose_mae_dtheta": 0.07518276572227478,
      "pose_mae_dx": 0.01608896814286709,
      "pose_mae_dy": 0.024771712720394135,
      "pose_rmse_dtheta": 0.1944645345211029,
      "pose_rmse_dx": 0.037534285336732864,
      "pose_rmse_dy": 0.059990279376506805,
      "pose_rmse_mean": 0.09732969850301743,
      "rmse_dtheta": 0.02393471449613571,
      "rmse_dx": 0.003897841786965728,
      "rmse_dy": 0.0036852385383099318,
      "rmse_mean": 0.01050593238323927,
      "rotation_flip": 0.005263158120214939,
      "sparse_tokens": 32089.0,
      "step": 3911,
      "turn_loss": 0.07366832345724106,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18175060397695594,
      "grad_norm": 0.5289015173912048,
      "learning_rate": 7.69095713117237e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.013838732615113258,
      "mae_dx": 0.004054971504956484,
      "mae_dy": 0.003206959692761302,
      "pose_mae_dtheta": 0.09689416736364365,
      "pose_mae_dx": 0.042294733226299286,
      "pose_mae_dy": 0.03922782838344574,
      "pose_rmse_dtheta": 0.20152725279331207,
      "pose_rmse_dx": 0.1330213099718094,
      "pose_rmse_dy": 0.09438731521368027,
      "pose_rmse_mean": 0.14297863841056824,
      "rmse_dtheta": 0.026928983628749847,
      "rmse_dx": 0.013193735852837563,
      "rmse_dy": 0.0068756951950490475,
      "rmse_mean": 0.015666138380765915,
      "rotation_flip": 0.006726457271724939,
      "sparse_tokens": 32057.0,
      "step": 3912,
      "turn_loss": 0.15122723579406738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.18179706374279875,
      "grad_norm": 0.5017786026000977,
      "learning_rate": 7.689842640888063e-06,
      "loss": 0.118,
      "mae_dtheta": 0.03745156526565552,
      "mae_dx": 0.00998794473707676,
      "mae_dy": 0.004819602705538273,
      "pose_mae_dtheta": 0.2639302611351013,
      "pose_mae_dx": 0.07263090461492538,
      "pose_mae_dy": 0.04019594192504883,
      "pose_rmse_dtheta": 0.45846429467201233,
      "pose_rmse_dx": 0.14678841829299927,
      "pose_rmse_dy": 0.0768134668469429,
      "pose_rmse_mean": 0.22735540568828583,
      "rmse_dtheta": 0.056309182196855545,
      "rmse_dx": 0.020629974082112312,
      "rmse_dy": 0.009699095040559769,
      "rmse_mean": 0.028879418969154358,
      "rotation_flip": 0.008130080997943878,
      "sparse_tokens": 12209.0,
      "step": 3913,
      "turn_loss": 0.29284393787384033,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 27257.0,
      "epoch": 0.18184352350864152,
      "grad_norm": 0.4467391073703766,
      "learning_rate": 7.688727962501617e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.030190972611308098,
      "mae_dx": 0.012509028427302837,
      "mae_dy": 0.0026749316602945328,
      "pose_mae_dtheta": 0.22311970591545105,
      "pose_mae_dx": 0.09424539655447006,
      "pose_mae_dy": 0.026976438239216805,
      "pose_rmse_dtheta": 0.43743932247161865,
      "pose_rmse_dx": 0.22638706862926483,
      "pose_rmse_dy": 0.06301731616258621,
      "pose_rmse_mean": 0.2422812432050705,
      "rmse_dtheta": 0.050222527235746384,
      "rmse_dx": 0.02569454163312912,
      "rmse_dy": 0.006155692972242832,
      "rmse_mean": 0.027357585728168488,
      "rotation_flip": 0.007915567606687546,
      "sparse_tokens": 21225.0,
      "step": 3914,
      "turn_loss": 0.20150847733020782,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.1818899832744843,
      "grad_norm": 0.451694130897522,
      "learning_rate": 7.687613096090981e-06,
      "loss": 0.1281,
      "mae_dtheta": 0.010074226185679436,
      "mae_dx": 0.002696174895390868,
      "mae_dy": 0.0028774335514754057,
      "pose_mae_dtheta": 0.0758742243051529,
      "pose_mae_dx": 0.03230440244078636,
      "pose_mae_dy": 0.025536421686410904,
      "pose_rmse_dtheta": 0.21102918684482574,
      "pose_rmse_dx": 0.08012044429779053,
      "pose_rmse_dy": 0.0640798956155777,
      "pose_rmse_mean": 0.11840983480215073,
      "rmse_dtheta": 0.023880595341324806,
      "rmse_dx": 0.007027830462902784,
      "rmse_dy": 0.006266404874622822,
      "rmse_mean": 0.012391611002385616,
      "rotation_flip": 0.0035335689317435026,
      "sparse_tokens": 32185.0,
      "step": 3915,
      "turn_loss": 0.08329536020755768,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.18193644304032708,
      "grad_norm": 0.6113772988319397,
      "learning_rate": 7.686498041734121e-06,
      "loss": 0.1986,
      "mae_dtheta": 0.0392799898982048,
      "mae_dx": 0.011680792085826397,
      "mae_dy": 0.004937061574310064,
      "pose_mae_dtheta": 0.32286328077316284,
      "pose_mae_dx": 0.10037730634212494,
      "pose_mae_dy": 0.05463900789618492,
      "pose_rmse_dtheta": 0.5509427785873413,
      "pose_rmse_dx": 0.20792044699192047,
      "pose_rmse_dy": 0.1378106027841568,
      "pose_rmse_mean": 0.2988912761211395,
      "rmse_dtheta": 0.05896208807826042,
      "rmse_dx": 0.023647408932447433,
      "rmse_dy": 0.011254813522100449,
      "rmse_mean": 0.03128810226917267,
      "rotation_flip": 0.01690821163356304,
      "sparse_tokens": 20305.0,
      "step": 3916,
      "turn_loss": 0.32375699281692505,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 35363.0,
      "epoch": 0.18198290280616986,
      "grad_norm": 0.3799430727958679,
      "learning_rate": 7.685382799509007e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.03223971650004387,
      "mae_dx": 0.010215646587312222,
      "mae_dy": 0.005001327954232693,
      "pose_mae_dtheta": 0.23404908180236816,
      "pose_mae_dx": 0.07366294413805008,
      "pose_mae_dy": 0.06145815551280975,
      "pose_rmse_dtheta": 0.41918107867240906,
      "pose_rmse_dx": 0.15968988835811615,
      "pose_rmse_dy": 0.14462928473949432,
      "pose_rmse_mean": 0.24116675555706024,
      "rmse_dtheta": 0.05001577362418175,
      "rmse_dx": 0.021484555676579475,
      "rmse_dy": 0.009941245429217815,
      "rmse_mean": 0.027147192507982254,
      "rotation_flip": 0.011337868869304657,
      "sparse_tokens": 28058.0,
      "step": 3917,
      "turn_loss": 0.23878099024295807,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 1980.0,
      "epoch": 0.18202936257201263,
      "grad_norm": 0.5067938566207886,
      "learning_rate": 7.684267369493634e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.064481720328331,
      "mae_dx": 0.039666302502155304,
      "mae_dy": 0.03160484507679939,
      "pose_mae_dtheta": 0.49231743812561035,
      "pose_mae_dx": 0.2566877007484436,
      "pose_mae_dy": 0.3451291024684906,
      "pose_rmse_dtheta": 0.6027798652648926,
      "pose_rmse_dx": 0.3794872462749481,
      "pose_rmse_dy": 0.479208379983902,
      "pose_rmse_mean": 0.48715850710868835,
      "rmse_dtheta": 0.07715704292058945,
      "rmse_dx": 0.046677760779857635,
      "rmse_dy": 0.03752899914979935,
      "rmse_mean": 0.05378793925046921,
      "rotation_flip": 0.009615384973585606,
      "sparse_tokens": 1807.0,
      "step": 3918,
      "turn_loss": 0.9620122313499451,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.1820758223378554,
      "grad_norm": 0.556775689125061,
      "learning_rate": 7.683151751766005e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.038551900535821915,
      "mae_dx": 0.01360337994992733,
      "mae_dy": 0.004603276494890451,
      "pose_mae_dtheta": 0.2959485650062561,
      "pose_mae_dx": 0.11044386774301529,
      "pose_mae_dy": 0.05502475053071976,
      "pose_rmse_dtheta": 0.47286850214004517,
      "pose_rmse_dx": 0.24376286566257477,
      "pose_rmse_dy": 0.1184772253036499,
      "pose_rmse_mean": 0.2783695459365845,
      "rmse_dtheta": 0.054861199110746384,
      "rmse_dx": 0.02574944868683815,
      "rmse_dy": 0.008604063652455807,
      "rmse_mean": 0.02973823808133602,
      "rotation_flip": 0.01230012346059084,
      "sparse_tokens": 12733.0,
      "step": 3919,
      "turn_loss": 0.3098224103450775,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 13649.0,
      "epoch": 0.18212228210369819,
      "grad_norm": 0.4302500784397125,
      "learning_rate": 7.682035946404133e-06,
      "loss": 0.0842,
      "mae_dtheta": 0.027748987078666687,
      "mae_dx": 0.007848215289413929,
      "mae_dy": 0.007669704966247082,
      "pose_mae_dtheta": 0.20185650885105133,
      "pose_mae_dx": 0.07320746034383774,
      "pose_mae_dy": 0.08362685889005661,
      "pose_rmse_dtheta": 0.3519180119037628,
      "pose_rmse_dx": 0.16279299557209015,
      "pose_rmse_dy": 0.17595410346984863,
      "pose_rmse_mean": 0.2302217185497284,
      "rmse_dtheta": 0.04322153329849243,
      "rmse_dx": 0.01852547936141491,
      "rmse_dy": 0.015400473959743977,
      "rmse_mean": 0.02571583166718483,
      "rotation_flip": 0.0097902100533247,
      "sparse_tokens": 11269.0,
      "step": 3920,
      "turn_loss": 0.2813590466976166,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.182168741869541,
      "grad_norm": 0.4968702495098114,
      "learning_rate": 7.680919953486047e-06,
      "loss": 0.0871,
      "mae_dtheta": 0.014875938184559345,
      "mae_dx": 0.0020619321148842573,
      "mae_dy": 0.003997473511844873,
      "pose_mae_dtheta": 0.10526344925165176,
      "pose_mae_dx": 0.03632403537631035,
      "pose_mae_dy": 0.048894528299570084,
      "pose_rmse_dtheta": 0.23005905747413635,
      "pose_rmse_dx": 0.09646734595298767,
      "pose_rmse_dy": 0.14464962482452393,
      "pose_rmse_mean": 0.1570586860179901,
      "rmse_dtheta": 0.02803155407309532,
      "rmse_dx": 0.00641642278060317,
      "rmse_dy": 0.009875448420643806,
      "rmse_mean": 0.014774474315345287,
      "rotation_flip": 0.006961259059607983,
      "sparse_tokens": 32105.0,
      "step": 3921,
      "turn_loss": 0.11162715405225754,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18221520163538377,
      "grad_norm": 0.6776198148727417,
      "learning_rate": 7.679803773089792e-06,
      "loss": 0.0915,
      "mae_dtheta": 0.009065471589565277,
      "mae_dx": 0.0024784523993730545,
      "mae_dy": 0.0025390551891177893,
      "pose_mae_dtheta": 0.06345324218273163,
      "pose_mae_dx": 0.028675561770796776,
      "pose_mae_dy": 0.025187071412801743,
      "pose_rmse_dtheta": 0.1407213658094406,
      "pose_rmse_dx": 0.0818743109703064,
      "pose_rmse_dy": 0.05494501814246178,
      "pose_rmse_mean": 0.0925135612487793,
      "rmse_dtheta": 0.01902814209461212,
      "rmse_dx": 0.008130934089422226,
      "rmse_dy": 0.006299431435763836,
      "rmse_mean": 0.011152836494147778,
      "rotation_flip": 0.0031347961630672216,
      "sparse_tokens": 32057.0,
      "step": 3922,
      "turn_loss": 0.09306503087282181,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.18226166140122654,
      "grad_norm": 0.47413742542266846,
      "learning_rate": 7.678687405293416e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.04095691815018654,
      "mae_dx": 0.014766830019652843,
      "mae_dy": 0.006838614121079445,
      "pose_mae_dtheta": 0.31278055906295776,
      "pose_mae_dx": 0.0890762209892273,
      "pose_mae_dy": 0.10132774710655212,
      "pose_rmse_dtheta": 0.6195365190505981,
      "pose_rmse_dx": 0.21410126984119415,
      "pose_rmse_dy": 0.20672546327114105,
      "pose_rmse_mean": 0.3467877507209778,
      "rmse_dtheta": 0.06162748858332634,
      "rmse_dx": 0.028187928721308708,
      "rmse_dy": 0.012198338285088539,
      "rmse_mean": 0.034004583954811096,
      "rotation_flip": 0.0059523810632526875,
      "sparse_tokens": 5645.0,
      "step": 3923,
      "turn_loss": 0.3126000463962555,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.18230812116706932,
      "grad_norm": 0.7192865014076233,
      "learning_rate": 7.677570850174996e-06,
      "loss": 0.1409,
      "mae_dtheta": 0.016286905854940414,
      "mae_dx": 0.0036603412590920925,
      "mae_dy": 0.0056470464915037155,
      "pose_mae_dtheta": 0.10707763582468033,
      "pose_mae_dx": 0.04471595585346222,
      "pose_mae_dy": 0.04490453749895096,
      "pose_rmse_dtheta": 0.23665368556976318,
      "pose_rmse_dx": 0.09801160544157028,
      "pose_rmse_dy": 0.1035684272646904,
      "pose_rmse_mean": 0.14607791602611542,
      "rmse_dtheta": 0.030943524092435837,
      "rmse_dx": 0.008756333030760288,
      "rmse_dy": 0.011063545010983944,
      "rmse_mean": 0.016921134665608406,
      "rotation_flip": 0.007250945549458265,
      "sparse_tokens": 32121.0,
      "step": 3924,
      "turn_loss": 0.1601879596710205,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.1823545809329121,
      "grad_norm": 0.7072190642356873,
      "learning_rate": 7.676454107812608e-06,
      "loss": 0.1022,
      "mae_dtheta": 0.03241599351167679,
      "mae_dx": 0.01414965558797121,
      "mae_dy": 0.004704650491476059,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7072190642356873,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 145.92092895507812,
      "model/head/act_norm_mean": 109.52822989004629,
      "model/head/act_norm_min": 81.91796112060547,
      "model/head/act_over_embed": 75.26882499988379,
      "model/head/grad_frac": 0.08106663823127747,
      "model/head/grad_norm": 0.0573318712413311,
      "model/head/grad_zero_frac": 0.00016529859567526728,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6840277777777778,
      "model/head/update_ratio": 0.0009855577955022454,
      "model/head/weight_delta": 7.398532390594482,
      "model/head/weight_delta_rel": 0.12979216873645782,
      "model/head/weight_norm": 58.172000885009766,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4174426794052124,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41740546907697407,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41735193133354187,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28684494616126666,
      "model/modality_embedder.encoders.pose/grad_frac": 0.14734934270381927,
      "model/modality_embedder.encoders.pose/grad_norm": 0.10420826822519302,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5478515625,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0033756536431610584,
      "model/modality_embedder.encoders.pose/weight_delta": 2.425448417663574,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07924696058034897,
      "model/modality_embedder.encoders.pose/weight_norm": 30.87054443359375,
      "model/modality_embedder/grad_frac": 0.14734934270381927,
      "model/modality_embedder/grad_norm": 0.10420826822519302,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5478515625,
      "model/modality_embedder/update_ratio": 0.0033756536431610584,
      "model/modality_embedder/weight_delta": 2.425448417663574,
      "model/modality_embedder/weight_delta_rel": 0.07924696058034897,
      "model/modality_embedder/weight_norm": 30.87054443359375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.14139556884766,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.474883799970605,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.28239631652832,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.132159922664552,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06702594459056854,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0474020279943943,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001708557247184217,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.724575400352478,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06284456700086594,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.743892669677734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.38542938232422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.37647661302175,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.434978485107422,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.751742944638202,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06541922688484192,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.046265725046396255,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015731871826574206,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.1794140338897705,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.075496606528759,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.408912658691406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.0429458618164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.08143187830688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.614733695983887,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.923404164984824,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0636262372136116,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.044997688382864,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001482080901041627,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.3381805419921875,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07851172238588333,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.361154556274414,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.39652252197266,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.98646246693122,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.845373153686523,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.232559020664837,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06350166350603104,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.044909585267305374,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015133596025407314,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 1.9967669248580933,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06824001669883728,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.67542266845703,
      "model/normalizer/grad_frac": 0.2623167335987091,
      "model/normalizer/grad_norm": 0.1855154037475586,
      "model/normalizer/grad_zero_frac": 0.0002162581222364679,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002370713744312525,
      "model/normalizer/weight_delta": 4.241631984710693,
      "model/normalizer/weight_delta_rel": 0.05462976545095444,
      "model/normalizer/weight_norm": 78.25297546386719,
      "pose_mae_dtheta": 0.27712246775627136,
      "pose_mae_dx": 0.10973331332206726,
      "pose_mae_dy": 0.07280844449996948,
      "pose_rmse_dtheta": 0.5331266522407532,
      "pose_rmse_dx": 0.25903451442718506,
      "pose_rmse_dy": 0.16637162864208221,
      "pose_rmse_mean": 0.31951093673706055,
      "rmse_dtheta": 0.0534413643181324,
      "rmse_dx": 0.029574774205684662,
      "rmse_dy": 0.008737201802432537,
      "rmse_mean": 0.03058444708585739,
      "rotation_flip": 0.021791767328977585,
      "sparse_tokens": 6987.0,
      "step": 3925,
      "turn_loss": 0.31433582305908203,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.18240104069875487,
      "grad_norm": 0.5205438137054443,
      "learning_rate": 7.675337178284347e-06,
      "loss": 0.1088,
      "mae_dtheta": 0.010076451115310192,
      "mae_dx": 0.002802763832733035,
      "mae_dy": 0.0016331803053617477,
      "pose_mae_dtheta": 0.0723666399717331,
      "pose_mae_dx": 0.02813176065683365,
      "pose_mae_dy": 0.0267177727073431,
      "pose_rmse_dtheta": 0.18250355124473572,
      "pose_rmse_dx": 0.08331108838319778,
      "pose_rmse_dy": 0.06317504495382309,
      "pose_rmse_mean": 0.1096632331609726,
      "rmse_dtheta": 0.022588245570659637,
      "rmse_dx": 0.009517966769635677,
      "rmse_dy": 0.0033222760539501905,
      "rmse_mean": 0.011809497140347958,
      "rotation_flip": 0.0031578948255628347,
      "sparse_tokens": 32073.0,
      "step": 3926,
      "turn_loss": 0.07454540580511093,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.18244750046459765,
      "grad_norm": 0.7424176931381226,
      "learning_rate": 7.674220061668323e-06,
      "loss": 0.1869,
      "mae_dtheta": 0.0300831887871027,
      "mae_dx": 0.01005137525498867,
      "mae_dy": 0.0072903623804450035,
      "pose_mae_dtheta": 0.2263905256986618,
      "pose_mae_dx": 0.08871869742870331,
      "pose_mae_dy": 0.08785095065832138,
      "pose_rmse_dtheta": 0.4100758135318756,
      "pose_rmse_dx": 0.21129748225212097,
      "pose_rmse_dy": 0.20603886246681213,
      "pose_rmse_mean": 0.2758040428161621,
      "rmse_dtheta": 0.047498077154159546,
      "rmse_dx": 0.02233746089041233,
      "rmse_dy": 0.01414608396589756,
      "rmse_mean": 0.02799387276172638,
      "rotation_flip": 0.01744186133146286,
      "sparse_tokens": 8683.0,
      "step": 3927,
      "turn_loss": 0.26325851678848267,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 2302.0,
      "epoch": 0.18249396023044043,
      "grad_norm": 1.0842981338500977,
      "learning_rate": 7.673102758042653e-06,
      "loss": 0.2619,
      "mae_dtheta": 0.03545021638274193,
      "mae_dx": 0.013493143022060394,
      "mae_dy": 0.00447249598801136,
      "pose_mae_dtheta": 0.2568734884262085,
      "pose_mae_dx": 0.11631633341312408,
      "pose_mae_dy": 0.09172193706035614,
      "pose_rmse_dtheta": 0.39131495356559753,
      "pose_rmse_dx": 0.29896092414855957,
      "pose_rmse_dy": 0.18990419805049896,
      "pose_rmse_mean": 0.2933933734893799,
      "rmse_dtheta": 0.05077638477087021,
      "rmse_dx": 0.029334796592593193,
      "rmse_dy": 0.0067639825865626335,
      "rmse_mean": 0.028958387672901154,
      "rotation_flip": 0.0,
      "sparse_tokens": 1873.0,
      "step": 3928,
      "turn_loss": 0.25572720170021057,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.18254041999628323,
      "grad_norm": 0.5288719534873962,
      "learning_rate": 7.671985267485474e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.014277290552854538,
      "mae_dx": 0.003585109021514654,
      "mae_dy": 0.004470342770218849,
      "pose_mae_dtheta": 0.11202487349510193,
      "pose_mae_dx": 0.03249693661928177,
      "pose_mae_dy": 0.036266766488552094,
      "pose_rmse_dtheta": 0.2813754081726074,
      "pose_rmse_dx": 0.077146977186203,
      "pose_rmse_dy": 0.08047298341989517,
      "pose_rmse_mean": 0.146331787109375,
      "rmse_dtheta": 0.031194418668746948,
      "rmse_dx": 0.01055569015443325,
      "rmse_dy": 0.011980520561337471,
      "rmse_mean": 0.01791021041572094,
      "rotation_flip": 0.006382978521287441,
      "sparse_tokens": 32121.0,
      "step": 3929,
      "turn_loss": 0.13649964332580566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.182586879762126,
      "grad_norm": 0.5781918168067932,
      "learning_rate": 7.670867590074928e-06,
      "loss": 0.1161,
      "mae_dtheta": 0.008186566643416882,
      "mae_dx": 0.0020575616508722305,
      "mae_dy": 0.0006569735123775899,
      "pose_mae_dtheta": 0.06202024221420288,
      "pose_mae_dx": 0.017585812136530876,
      "pose_mae_dy": 0.009220315143465996,
      "pose_rmse_dtheta": 0.22445079684257507,
      "pose_rmse_dx": 0.04309239238500595,
      "pose_rmse_dy": 0.022535812109708786,
      "pose_rmse_mean": 0.0966930016875267,
      "rmse_dtheta": 0.026844562962651253,
      "rmse_dx": 0.005606393795460463,
      "rmse_dy": 0.001825874438509345,
      "rmse_mean": 0.011425609700381756,
      "rotation_flip": 0.0044843051582574844,
      "sparse_tokens": 32217.0,
      "step": 3930,
      "turn_loss": 0.05683717876672745,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.18263333952796879,
      "grad_norm": 0.9411381483078003,
      "learning_rate": 7.669749725889182e-06,
      "loss": 0.1538,
      "mae_dtheta": 0.03889283537864685,
      "mae_dx": 0.015948878601193428,
      "mae_dy": 0.004033212084323168,
      "pose_mae_dtheta": 0.3200235366821289,
      "pose_mae_dx": 0.13121898472309113,
      "pose_mae_dy": 0.04942319542169571,
      "pose_rmse_dtheta": 0.5453999042510986,
      "pose_rmse_dx": 0.3094407320022583,
      "pose_rmse_dy": 0.12909965217113495,
      "pose_rmse_mean": 0.327980101108551,
      "rmse_dtheta": 0.057608190923929214,
      "rmse_dx": 0.03139299526810646,
      "rmse_dy": 0.008557586930692196,
      "rmse_mean": 0.032519593834877014,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 5320.0,
      "step": 3931,
      "turn_loss": 0.2860954999923706,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.18267979929381156,
      "grad_norm": 0.5966079831123352,
      "learning_rate": 7.668631675006401e-06,
      "loss": 0.1362,
      "mae_dtheta": 0.02986275777220726,
      "mae_dx": 0.015497706830501556,
      "mae_dy": 0.009517106227576733,
      "pose_mae_dtheta": 0.2575467824935913,
      "pose_mae_dx": 0.11286178976297379,
      "pose_mae_dy": 0.1215234249830246,
      "pose_rmse_dtheta": 0.4741872251033783,
      "pose_rmse_dx": 0.22028785943984985,
      "pose_rmse_dy": 0.26909154653549194,
      "pose_rmse_mean": 0.32118886709213257,
      "rmse_dtheta": 0.04682612419128418,
      "rmse_dx": 0.02942531928420067,
      "rmse_dy": 0.017970168963074684,
      "rmse_mean": 0.03140720725059509,
      "rotation_flip": 0.004999999888241291,
      "sparse_tokens": 4074.0,
      "step": 3932,
      "turn_loss": 0.41582414507865906,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 15267.0,
      "epoch": 0.18272625905965434,
      "grad_norm": 0.46931496262550354,
      "learning_rate": 7.667513437504778e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.026583202183246613,
      "mae_dx": 0.008339404128491879,
      "mae_dy": 0.0041044484823942184,
      "pose_mae_dtheta": 0.17609760165214539,
      "pose_mae_dx": 0.06957893818616867,
      "pose_mae_dy": 0.042187511920928955,
      "pose_rmse_dtheta": 0.36816659569740295,
      "pose_rmse_dx": 0.1889260709285736,
      "pose_rmse_dy": 0.09389738738536835,
      "pose_rmse_mean": 0.2169966995716095,
      "rmse_dtheta": 0.04375653713941574,
      "rmse_dx": 0.021056530997157097,
      "rmse_dy": 0.009030506014823914,
      "rmse_mean": 0.024614525958895683,
      "rotation_flip": 0.017741935327649117,
      "sparse_tokens": 12944.0,
      "step": 3933,
      "turn_loss": 0.21098558604717255,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.18277271882549712,
      "grad_norm": 0.530460774898529,
      "learning_rate": 7.666395013462506e-06,
      "loss": 0.1206,
      "mae_dtheta": 0.0369090661406517,
      "mae_dx": 0.011555053293704987,
      "mae_dy": 0.0035877064801752567,
      "pose_mae_dtheta": 0.27632203698158264,
      "pose_mae_dx": 0.09541656076908112,
      "pose_mae_dy": 0.04017214477062225,
      "pose_rmse_dtheta": 0.4959534704685211,
      "pose_rmse_dx": 0.1941716969013214,
      "pose_rmse_dy": 0.11006893962621689,
      "pose_rmse_mean": 0.2667313814163208,
      "rmse_dtheta": 0.05692838504910469,
      "rmse_dx": 0.02312299981713295,
      "rmse_dy": 0.00760747492313385,
      "rmse_mean": 0.029219619929790497,
      "rotation_flip": 0.013461538590490818,
      "sparse_tokens": 8680.0,
      "step": 3934,
      "turn_loss": 0.22102932631969452,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1828191785913399,
      "grad_norm": 0.5039802193641663,
      "learning_rate": 7.665276402957802e-06,
      "loss": 0.0891,
      "mae_dtheta": 0.006332252640277147,
      "mae_dx": 0.0013541983207687736,
      "mae_dy": 0.0011125372257083654,
      "pose_mae_dtheta": 0.04887736588716507,
      "pose_mae_dx": 0.014995572157204151,
      "pose_mae_dy": 0.015533596277236938,
      "pose_rmse_dtheta": 0.15965792536735535,
      "pose_rmse_dx": 0.051821738481521606,
      "pose_rmse_dy": 0.045341163873672485,
      "pose_rmse_mean": 0.08560694754123688,
      "rmse_dtheta": 0.01875162683427334,
      "rmse_dx": 0.0042104898020625114,
      "rmse_dy": 0.003575647249817848,
      "rmse_mean": 0.008845921605825424,
      "rotation_flip": 0.0012531328247860074,
      "sparse_tokens": 32089.0,
      "step": 3935,
      "turn_loss": 0.055563975125551224,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18286563835718267,
      "grad_norm": 0.6732048988342285,
      "learning_rate": 7.664157606068885e-06,
      "loss": 0.1603,
      "mae_dtheta": 0.010420642793178558,
      "mae_dx": 0.0016289792256429791,
      "mae_dy": 0.0016315920511260629,
      "pose_mae_dtheta": 0.06841829419136047,
      "pose_mae_dx": 0.020674172788858414,
      "pose_mae_dy": 0.025536339730024338,
      "pose_rmse_dtheta": 0.16270196437835693,
      "pose_rmse_dx": 0.05355659872293472,
      "pose_rmse_dy": 0.05530892685055733,
      "pose_rmse_mean": 0.09052249789237976,
      "rmse_dtheta": 0.021678704768419266,
      "rmse_dx": 0.0055264015682041645,
      "rmse_dy": 0.002828326541930437,
      "rmse_mean": 0.010011143982410431,
      "rotation_flip": 0.003869968932121992,
      "sparse_tokens": 32089.0,
      "step": 3936,
      "turn_loss": 0.08858302980661392,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.18291209812302545,
      "grad_norm": 0.5471273064613342,
      "learning_rate": 7.663038622873999e-06,
      "loss": 0.195,
      "mae_dtheta": 0.03902219608426094,
      "mae_dx": 0.013726728036999702,
      "mae_dy": 0.006682305131107569,
      "pose_mae_dtheta": 0.31563830375671387,
      "pose_mae_dx": 0.11327485740184784,
      "pose_mae_dy": 0.08590973913669586,
      "pose_rmse_dtheta": 0.5502314567565918,
      "pose_rmse_dx": 0.22807228565216064,
      "pose_rmse_dy": 0.19092489778995514,
      "pose_rmse_mean": 0.3230762183666229,
      "rmse_dtheta": 0.05739722400903702,
      "rmse_dx": 0.02690974250435829,
      "rmse_dy": 0.012883340939879417,
      "rmse_mean": 0.032396771013736725,
      "rotation_flip": 0.01745200715959072,
      "sparse_tokens": 10795.0,
      "step": 3937,
      "turn_loss": 0.3376999795436859,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.18295855788886825,
      "grad_norm": 0.8171718716621399,
      "learning_rate": 7.661919453451394e-06,
      "loss": 0.1914,
      "mae_dtheta": 0.02032596431672573,
      "mae_dx": 0.020308656617999077,
      "mae_dy": 0.006014599464833736,
      "pose_mae_dtheta": 0.1351126879453659,
      "pose_mae_dx": 0.17347556352615356,
      "pose_mae_dy": 0.09098397940397263,
      "pose_rmse_dtheta": 0.19662027060985565,
      "pose_rmse_dx": 0.3571324050426483,
      "pose_rmse_dy": 0.16361606121063232,
      "pose_rmse_mean": 0.2391229122877121,
      "rmse_dtheta": 0.033356551080942154,
      "rmse_dx": 0.0364556722342968,
      "rmse_dy": 0.00968948658555746,
      "rmse_mean": 0.02650057151913643,
      "rotation_flip": 0.004854368977248669,
      "sparse_tokens": 3746.0,
      "step": 3938,
      "turn_loss": 0.18774424493312836,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18300501765471103,
      "grad_norm": 0.5117392539978027,
      "learning_rate": 7.660800097879332e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.012139660306274891,
      "mae_dx": 0.0016320196446031332,
      "mae_dy": 0.002151578664779663,
      "pose_mae_dtheta": 0.08433376997709274,
      "pose_mae_dx": 0.022742673754692078,
      "pose_mae_dy": 0.031186265870928764,
      "pose_rmse_dtheta": 0.22479791939258575,
      "pose_rmse_dx": 0.06914512068033218,
      "pose_rmse_dy": 0.07614694535732269,
      "pose_rmse_mean": 0.12336333841085434,
      "rmse_dtheta": 0.02749740146100521,
      "rmse_dx": 0.006014189217239618,
      "rmse_dy": 0.004506423603743315,
      "rmse_mean": 0.012672672048211098,
      "rotation_flip": 0.005804311949759722,
      "sparse_tokens": 32089.0,
      "step": 3939,
      "turn_loss": 0.08508040755987167,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.1830514774205538,
      "grad_norm": 0.6370651721954346,
      "learning_rate": 7.659680556236092e-06,
      "loss": 0.1187,
      "mae_dtheta": 0.028201207518577576,
      "mae_dx": 0.010179428383708,
      "mae_dy": 0.0062934160232543945,
      "pose_mae_dtheta": 0.19621992111206055,
      "pose_mae_dx": 0.07704737782478333,
      "pose_mae_dy": 0.07102271914482117,
      "pose_rmse_dtheta": 0.3748926520347595,
      "pose_rmse_dx": 0.18655984103679657,
      "pose_rmse_dy": 0.1343836635351181,
      "pose_rmse_mean": 0.23194539546966553,
      "rmse_dtheta": 0.04382200539112091,
      "rmse_dx": 0.02234208583831787,
      "rmse_dy": 0.010858369991183281,
      "rmse_mean": 0.025674154981970787,
      "rotation_flip": 0.030405405908823013,
      "sparse_tokens": 5952.0,
      "step": 3940,
      "turn_loss": 0.302997350692749,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.18309793718639658,
      "grad_norm": 0.6847184300422668,
      "learning_rate": 7.65856082859996e-06,
      "loss": 0.0911,
      "mae_dtheta": 0.008772572502493858,
      "mae_dx": 0.0015161362243816257,
      "mae_dy": 0.0003318627714179456,
      "pose_mae_dtheta": 0.0647677481174469,
      "pose_mae_dx": 0.011333370581269264,
      "pose_mae_dy": 0.003964714705944061,
      "pose_rmse_dtheta": 0.2783449590206146,
      "pose_rmse_dx": 0.027274247258901596,
      "pose_rmse_dy": 0.009597369469702244,
      "pose_rmse_mean": 0.10507219284772873,
      "rmse_dtheta": 0.031591083854436874,
      "rmse_dx": 0.004147068597376347,
      "rmse_dy": 0.0009171716519631445,
      "rmse_mean": 0.012218440882861614,
      "rotation_flip": 0.0011031439062207937,
      "sparse_tokens": 32233.0,
      "step": 3941,
      "turn_loss": 0.04872062802314758,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18314439695223936,
      "grad_norm": 0.5366808772087097,
      "learning_rate": 7.657440915049244e-06,
      "loss": 0.1132,
      "mae_dtheta": 0.01214859914034605,
      "mae_dx": 0.0023870517034083605,
      "mae_dy": 0.003390137106180191,
      "pose_mae_dtheta": 0.08119691908359528,
      "pose_mae_dx": 0.03503440320491791,
      "pose_mae_dy": 0.0370711088180542,
      "pose_rmse_dtheta": 0.17651531100273132,
      "pose_rmse_dx": 0.09377582371234894,
      "pose_rmse_dy": 0.08751602470874786,
      "pose_rmse_mean": 0.11926905810832977,
      "rmse_dtheta": 0.02316582389175892,
      "rmse_dx": 0.007087967824190855,
      "rmse_dy": 0.006889119744300842,
      "rmse_mean": 0.012380970641970634,
      "rotation_flip": 0.0056611401960253716,
      "sparse_tokens": 32057.0,
      "step": 3942,
      "turn_loss": 0.10089679807424545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29754.0,
      "epoch": 0.18319085671808213,
      "grad_norm": 1.3549213409423828,
      "learning_rate": 7.656320815662257e-06,
      "loss": 0.1907,
      "mae_dtheta": 0.03687519580125809,
      "mae_dx": 0.018347041681408882,
      "mae_dy": 0.006349699106067419,
      "pose_mae_dtheta": 0.3141152858734131,
      "pose_mae_dx": 0.1515122950077057,
      "pose_mae_dy": 0.09672009199857712,
      "pose_rmse_dtheta": 0.5208094120025635,
      "pose_rmse_dx": 0.29350847005844116,
      "pose_rmse_dy": 0.21583443880081177,
      "pose_rmse_mean": 0.34338411688804626,
      "rmse_dtheta": 0.05417487397789955,
      "rmse_dx": 0.031846433877944946,
      "rmse_dy": 0.0114788468927145,
      "rmse_mean": 0.03250005096197128,
      "rotation_flip": 0.015288394875824451,
      "sparse_tokens": 24436.0,
      "step": 3943,
      "turn_loss": 0.30125632882118225,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.1832373164839249,
      "grad_norm": 0.4115666151046753,
      "learning_rate": 7.655200530517332e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.03313734754920006,
      "mae_dx": 0.014415225945413113,
      "mae_dy": 0.0038082522805780172,
      "pose_mae_dtheta": 0.28113114833831787,
      "pose_mae_dx": 0.11529633402824402,
      "pose_mae_dy": 0.0505046509206295,
      "pose_rmse_dtheta": 0.5102611184120178,
      "pose_rmse_dx": 0.2532396912574768,
      "pose_rmse_dy": 0.11352765560150146,
      "pose_rmse_mean": 0.2923428416252136,
      "rmse_dtheta": 0.051628030836582184,
      "rmse_dx": 0.027671311050653458,
      "rmse_dy": 0.007025059312582016,
      "rmse_mean": 0.0287748035043478,
      "rotation_flip": 0.007029877044260502,
      "sparse_tokens": 10935.0,
      "step": 3944,
      "turn_loss": 0.21467122435569763,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.1832837762497677,
      "grad_norm": 0.48558807373046875,
      "learning_rate": 7.654080059692808e-06,
      "loss": 0.1101,
      "mae_dtheta": 0.032001037150621414,
      "mae_dx": 0.010260905139148235,
      "mae_dy": 0.004063038621097803,
      "pose_mae_dtheta": 0.20592080056667328,
      "pose_mae_dx": 0.079368956387043,
      "pose_mae_dy": 0.04316488653421402,
      "pose_rmse_dtheta": 0.4050505757331848,
      "pose_rmse_dx": 0.19066204130649567,
      "pose_rmse_dy": 0.08496042340993881,
      "pose_rmse_mean": 0.22689101099967957,
      "rmse_dtheta": 0.05050509795546532,
      "rmse_dx": 0.02235986292362213,
      "rmse_dy": 0.007327483966946602,
      "rmse_mean": 0.026730816811323166,
      "rotation_flip": 0.01112656481564045,
      "sparse_tokens": 12760.0,
      "step": 3945,
      "turn_loss": 0.26562824845314026,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.1833302360156105,
      "grad_norm": 0.5610741972923279,
      "learning_rate": 7.65295940326704e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.021832307800650597,
      "mae_dx": 0.012423494830727577,
      "mae_dy": 0.004292223136872053,
      "pose_mae_dtheta": 0.14547236263751984,
      "pose_mae_dx": 0.08602111041545868,
      "pose_mae_dy": 0.04950616508722305,
      "pose_rmse_dtheta": 0.266948938369751,
      "pose_rmse_dx": 0.22950373589992523,
      "pose_rmse_dy": 0.09361149370670319,
      "pose_rmse_mean": 0.19668805599212646,
      "rmse_dtheta": 0.03298882395029068,
      "rmse_dx": 0.02677658572793007,
      "rmse_dy": 0.007017519325017929,
      "rmse_mean": 0.02226097695529461,
      "rotation_flip": 0.009756097570061684,
      "sparse_tokens": 2864.0,
      "step": 3946,
      "turn_loss": 0.2384525090456009,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.18337669578145327,
      "grad_norm": 0.38270774483680725,
      "learning_rate": 7.6518385613184e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.012730139307677746,
      "mae_dx": 0.0027878640685230494,
      "mae_dy": 0.003115561557933688,
      "pose_mae_dtheta": 0.0852668285369873,
      "pose_mae_dx": 0.03455168381333351,
      "pose_mae_dy": 0.03015432320535183,
      "pose_rmse_dtheta": 0.20719043910503387,
      "pose_rmse_dx": 0.0937030166387558,
      "pose_rmse_dy": 0.06821306049823761,
      "pose_rmse_mean": 0.12303551286458969,
      "rmse_dtheta": 0.026678504422307014,
      "rmse_dx": 0.008259834721684456,
      "rmse_dy": 0.0074641043320298195,
      "rmse_mean": 0.014134148135781288,
      "rotation_flip": 0.0023715414572507143,
      "sparse_tokens": 32121.0,
      "step": 3947,
      "turn_loss": 0.10743033140897751,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18342315554729605,
      "grad_norm": 0.44970664381980896,
      "learning_rate": 7.650717533925263e-06,
      "loss": 0.11,
      "mae_dtheta": 0.014408079907298088,
      "mae_dx": 0.0028777276165783405,
      "mae_dy": 0.002787759993225336,
      "pose_mae_dtheta": 0.10245081037282944,
      "pose_mae_dx": 0.03238833695650101,
      "pose_mae_dy": 0.03918442502617836,
      "pose_rmse_dtheta": 0.23793084919452667,
      "pose_rmse_dx": 0.10512900352478027,
      "pose_rmse_dy": 0.11232969909906387,
      "pose_rmse_mean": 0.15179651975631714,
      "rmse_dtheta": 0.028387971222400665,
      "rmse_dx": 0.01010793074965477,
      "rmse_dy": 0.006611385848373175,
      "rmse_mean": 0.015035762451589108,
      "rotation_flip": 0.0043308790773153305,
      "sparse_tokens": 32057.0,
      "step": 3948,
      "turn_loss": 0.11059851944446564,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.18346961531313882,
      "grad_norm": 0.8053731918334961,
      "learning_rate": 7.649596321166024e-06,
      "loss": 0.1675,
      "mae_dtheta": 0.026459340006113052,
      "mae_dx": 0.00809437409043312,
      "mae_dy": 0.003200085135176778,
      "pose_mae_dtheta": 0.2434099167585373,
      "pose_mae_dx": 0.05388583615422249,
      "pose_mae_dy": 0.05958249047398567,
      "pose_rmse_dtheta": 0.447906494140625,
      "pose_rmse_dx": 0.12601733207702637,
      "pose_rmse_dy": 0.1298663169145584,
      "pose_rmse_mean": 0.23459671437740326,
      "rmse_dtheta": 0.04406019672751427,
      "rmse_dx": 0.019212400540709496,
      "rmse_dy": 0.005623946897685528,
      "rmse_mean": 0.022965513169765472,
      "rotation_flip": 0.013921113684773445,
      "sparse_tokens": 7762.0,
      "step": 3949,
      "turn_loss": 0.20393463969230652,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 39914.0,
      "epoch": 0.1835160750789816,
      "grad_norm": 0.6143433451652527,
      "learning_rate": 7.648474923119097e-06,
      "loss": 0.1601,
      "mae_dtheta": 0.025615455582737923,
      "mae_dx": 0.010953360237181187,
      "mae_dy": 0.0031817532144486904,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6143432259559631,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.40464782714844,
      "model/head/act_norm_mean": 112.37604007876017,
      "model/head/act_norm_min": 55.14698028564453,
      "model/head/act_over_embed": 77.22586682318702,
      "model/head/grad_frac": 0.09592554718255997,
      "model/head/grad_norm": 0.05893120914697647,
      "model/head/grad_zero_frac": 0.00018147945229429752,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6759956173780488,
      "model/head/update_ratio": 0.0010129522997885942,
      "model/head/weight_delta": 7.421145915985107,
      "model/head/weight_delta_rel": 0.13018888235092163,
      "model/head/weight_norm": 58.177677154541016,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41740483045578003,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4173539377027942,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4172881543636322,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2868095333184859,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08868830651044846,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05448506027460098,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.543000252016129,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017648559296503663,
      "model/modality_embedder.encoders.pose/weight_delta": 2.4406960010528564,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07974514365196228,
      "model/modality_embedder.encoders.pose/weight_norm": 30.872241973876953,
      "model/modality_embedder/grad_frac": 0.08868830651044846,
      "model/modality_embedder/grad_norm": 0.05448506027460098,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.543000252016129,
      "model/modality_embedder/update_ratio": 0.0017648559296503663,
      "model/modality_embedder/weight_delta": 2.4406960010528564,
      "model/modality_embedder/weight_delta_rel": 0.07974514365196228,
      "model/modality_embedder/weight_norm": 30.872241973876953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.36670684814453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.728166537617756,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.908894538879395,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.306218191246025,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10027950257062912,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0616060346364975,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0022204515989869833,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.7319657802581787,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06311387568712234,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.744821548461914,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.79585266113281,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.6248245741386,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.574828147888184,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.922409988587944,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09520771354436874,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05849021300673485,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001988745527341962,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.1893153190612793,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07583959400653839,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.410608291625977,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.58206939697266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.320767195767196,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.796921730041504,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.087877635836097,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08637663722038269,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05306490138173103,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001747651374898851,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.3492252826690674,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07888258993625641,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.363550186157227,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.13304901123047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.204590914956768,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.671546936035156,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.3824589322987,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08493781834840775,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05218097195029259,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001758297672495246,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.0054261684417725,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0685359463095665,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.676984786987305,
      "model/normalizer/grad_frac": 0.35887235403060913,
      "model/normalizer/grad_norm": 0.22047080099582672,
      "model/normalizer/grad_zero_frac": 0.0001689885975793004,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0028173234313726425,
      "model/normalizer/weight_delta": 4.2607831954956055,
      "model/normalizer/weight_delta_rel": 0.0548764206469059,
      "model/normalizer/weight_norm": 78.25540924072266,
      "pose_mae_dtheta": 0.19631172716617584,
      "pose_mae_dx": 0.09332402050495148,
      "pose_mae_dy": 0.03472735360264778,
      "pose_rmse_dtheta": 0.39906761050224304,
      "pose_rmse_dx": 0.21204398572444916,
      "pose_rmse_dy": 0.08851808309555054,
      "pose_rmse_mean": 0.23320989310741425,
      "rmse_dtheta": 0.04491887241601944,
      "rmse_dx": 0.0232948400080204,
      "rmse_dy": 0.007095141336321831,
      "rmse_mean": 0.025102954357862473,
      "rotation_flip": 0.008547008968889713,
      "sparse_tokens": 30014.0,
      "step": 3950,
      "turn_loss": 0.22474248707294464,
      "turns": 123.0,
      "turns_per_sample": 123.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.18356253484482438,
      "grad_norm": 0.5908911824226379,
      "learning_rate": 7.647353339862895e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.03322987258434296,
      "mae_dx": 0.010062654502689838,
      "mae_dy": 0.0017872708849608898,
      "pose_mae_dtheta": 0.288737028837204,
      "pose_mae_dx": 0.09075479954481125,
      "pose_mae_dy": 0.0239198487251997,
      "pose_rmse_dtheta": 0.5726988911628723,
      "pose_rmse_dx": 0.21423867344856262,
      "pose_rmse_dy": 0.0854329988360405,
      "pose_rmse_mean": 0.2907902002334595,
      "rmse_dtheta": 0.056141920387744904,
      "rmse_dx": 0.02227085269987583,
      "rmse_dy": 0.00354092032648623,
      "rmse_mean": 0.027317896485328674,
      "rotation_flip": 0.0181818176060915,
      "sparse_tokens": 5341.0,
      "step": 3951,
      "turn_loss": 0.16406400501728058,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.18360899461066715,
      "grad_norm": 0.4253796339035034,
      "learning_rate": 7.646231571475853e-06,
      "loss": 0.1439,
      "mae_dtheta": 0.01026104111224413,
      "mae_dx": 0.0021937533747404814,
      "mae_dy": 0.002912213560193777,
      "pose_mae_dtheta": 0.07184955477714539,
      "pose_mae_dx": 0.027188267558813095,
      "pose_mae_dy": 0.030641134828329086,
      "pose_rmse_dtheta": 0.17432628571987152,
      "pose_rmse_dx": 0.07581759244203568,
      "pose_rmse_dy": 0.0671226903796196,
      "pose_rmse_mean": 0.1057555302977562,
      "rmse_dtheta": 0.02163015305995941,
      "rmse_dx": 0.005992693826556206,
      "rmse_dy": 0.00667314138263464,
      "rmse_mean": 0.011431995779275894,
      "rotation_flip": 0.0038895371835678816,
      "sparse_tokens": 32105.0,
      "step": 3952,
      "turn_loss": 0.08177874982357025,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.18365545437650993,
      "grad_norm": 0.6917978525161743,
      "learning_rate": 7.645109618036416e-06,
      "loss": 0.1382,
      "mae_dtheta": 0.015030939131975174,
      "mae_dx": 0.0028548489790409803,
      "mae_dy": 0.004193688277155161,
      "pose_mae_dtheta": 0.10659003257751465,
      "pose_mae_dx": 0.039463672786951065,
      "pose_mae_dy": 0.04813573136925697,
      "pose_rmse_dtheta": 0.21891279518604279,
      "pose_rmse_dx": 0.09233303368091583,
      "pose_rmse_dy": 0.12277950346469879,
      "pose_rmse_mean": 0.1446751207113266,
      "rmse_dtheta": 0.026324734091758728,
      "rmse_dx": 0.008005013689398766,
      "rmse_dy": 0.009099170565605164,
      "rmse_mean": 0.014476306736469269,
      "rotation_flip": 0.008449789136648178,
      "sparse_tokens": 32121.0,
      "step": 3953,
      "turn_loss": 0.1375180184841156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14574.0,
      "epoch": 0.18370191414235273,
      "grad_norm": 0.4455336034297943,
      "learning_rate": 7.643987479623044e-06,
      "loss": 0.1069,
      "mae_dtheta": 0.02735304646193981,
      "mae_dx": 0.010060661472380161,
      "mae_dy": 0.004666913766413927,
      "pose_mae_dtheta": 0.21407026052474976,
      "pose_mae_dx": 0.0859089195728302,
      "pose_mae_dy": 0.058651041239500046,
      "pose_rmse_dtheta": 0.41934332251548767,
      "pose_rmse_dx": 0.21764622628688812,
      "pose_rmse_dy": 0.15919429063796997,
      "pose_rmse_mean": 0.2653946280479431,
      "rmse_dtheta": 0.047459181398153305,
      "rmse_dx": 0.022758441045880318,
      "rmse_dy": 0.009448626078665257,
      "rmse_mean": 0.026555417105555534,
      "rotation_flip": 0.005093378480523825,
      "sparse_tokens": 11997.0,
      "step": 3954,
      "turn_loss": 0.2213689237833023,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.1837483739081955,
      "grad_norm": 0.7669417858123779,
      "learning_rate": 7.64286515631421e-06,
      "loss": 0.184,
      "mae_dtheta": 0.042855605483055115,
      "mae_dx": 0.010937100276350975,
      "mae_dy": 0.006373437587171793,
      "pose_mae_dtheta": 0.3477901518344879,
      "pose_mae_dx": 0.08731263875961304,
      "pose_mae_dy": 0.06969761848449707,
      "pose_rmse_dtheta": 0.5544087886810303,
      "pose_rmse_dx": 0.20425710082054138,
      "pose_rmse_dy": 0.157079815864563,
      "pose_rmse_mean": 0.30524858832359314,
      "rmse_dtheta": 0.06025881692767143,
      "rmse_dx": 0.0226175244897604,
      "rmse_dy": 0.010662993416190147,
      "rmse_mean": 0.031179778277873993,
      "rotation_flip": 0.016583748161792755,
      "sparse_tokens": 9284.0,
      "step": 3955,
      "turn_loss": 0.3023846745491028,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1837948336740383,
      "grad_norm": 0.3767668306827545,
      "learning_rate": 7.641742648188397e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.010127331130206585,
      "mae_dx": 0.0014031492173671722,
      "mae_dy": 0.002141391858458519,
      "pose_mae_dtheta": 0.06429809331893921,
      "pose_mae_dx": 0.020464373752474785,
      "pose_mae_dy": 0.025132017210125923,
      "pose_rmse_dtheta": 0.13411957025527954,
      "pose_rmse_dx": 0.04600773751735687,
      "pose_rmse_dy": 0.05048342049121857,
      "pose_rmse_mean": 0.07687024772167206,
      "rmse_dtheta": 0.020432105287909508,
      "rmse_dx": 0.004280461929738522,
      "rmse_dy": 0.003966762218624353,
      "rmse_mean": 0.00955977663397789,
      "rotation_flip": 0.0040349699556827545,
      "sparse_tokens": 32105.0,
      "step": 3956,
      "turn_loss": 0.07805459201335907,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.18384129343988106,
      "grad_norm": 0.4145644009113312,
      "learning_rate": 7.640619955324102e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.023763468489050865,
      "mae_dx": 0.008412002585828304,
      "mae_dy": 0.004433710128068924,
      "pose_mae_dtheta": 0.18911468982696533,
      "pose_mae_dx": 0.06176955997943878,
      "pose_mae_dy": 0.04497900977730751,
      "pose_rmse_dtheta": 0.3972444236278534,
      "pose_rmse_dx": 0.16272160410881042,
      "pose_rmse_dy": 0.11675360798835754,
      "pose_rmse_mean": 0.22557322680950165,
      "rmse_dtheta": 0.04303910955786705,
      "rmse_dx": 0.01907493732869625,
      "rmse_dy": 0.01072632148861885,
      "rmse_mean": 0.02428012154996395,
      "rotation_flip": 0.013372956775128841,
      "sparse_tokens": 13865.0,
      "step": 3957,
      "turn_loss": 0.26739731431007385,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.18388775320572384,
      "grad_norm": 0.37499675154685974,
      "learning_rate": 7.639497077799836e-06,
      "loss": 0.0908,
      "mae_dtheta": 0.008714264258742332,
      "mae_dx": 0.0016881152987480164,
      "mae_dy": 0.0015646172687411308,
      "pose_mae_dtheta": 0.060063041746616364,
      "pose_mae_dx": 0.017556004226207733,
      "pose_mae_dy": 0.01782212033867836,
      "pose_rmse_dtheta": 0.18479932844638824,
      "pose_rmse_dx": 0.041384100914001465,
      "pose_rmse_dy": 0.041832298040390015,
      "pose_rmse_mean": 0.08933858573436737,
      "rmse_dtheta": 0.02233683317899704,
      "rmse_dx": 0.004801525734364986,
      "rmse_dy": 0.003485440043732524,
      "rmse_mean": 0.010207933373749256,
      "rotation_flip": 0.0063091483898460865,
      "sparse_tokens": 32217.0,
      "step": 3958,
      "turn_loss": 0.0671105831861496,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.18393421297156662,
      "grad_norm": 0.6613847613334656,
      "learning_rate": 7.638374015694123e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.032150186598300934,
      "mae_dx": 0.009458937682211399,
      "mae_dy": 0.003625475335866213,
      "pose_mae_dtheta": 0.26369649171829224,
      "pose_mae_dx": 0.06212267279624939,
      "pose_mae_dy": 0.045022912323474884,
      "pose_rmse_dtheta": 0.49427101016044617,
      "pose_rmse_dx": 0.1492481827735901,
      "pose_rmse_dy": 0.10434482991695404,
      "pose_rmse_mean": 0.24928800761699677,
      "rmse_dtheta": 0.05142504721879959,
      "rmse_dx": 0.02066122367978096,
      "rmse_dy": 0.006459936499595642,
      "rmse_mean": 0.02618207037448883,
      "rotation_flip": 0.018292682245373726,
      "sparse_tokens": 10842.0,
      "step": 3959,
      "turn_loss": 0.2208556830883026,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1839806727374094,
      "grad_norm": 0.5378385186195374,
      "learning_rate": 7.6372507690855e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.009505423717200756,
      "mae_dx": 0.0012896941043436527,
      "mae_dy": 0.0023163442965596914,
      "pose_mae_dtheta": 0.06272857636213303,
      "pose_mae_dx": 0.022093869745731354,
      "pose_mae_dy": 0.028580565005540848,
      "pose_rmse_dtheta": 0.12913355231285095,
      "pose_rmse_dx": 0.051194921135902405,
      "pose_rmse_dy": 0.06553585082292557,
      "pose_rmse_mean": 0.08195477724075317,
      "rmse_dtheta": 0.018223058432340622,
      "rmse_dx": 0.0037359350826591253,
      "rmse_dy": 0.00448267487809062,
      "rmse_mean": 0.0088138896971941,
      "rotation_flip": 0.0048560528084635735,
      "sparse_tokens": 32089.0,
      "step": 3960,
      "turn_loss": 0.07186722010374069,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.18402713250325217,
      "grad_norm": 0.3888205885887146,
      "learning_rate": 7.636127338052513e-06,
      "loss": 0.1333,
      "mae_dtheta": 0.03189294412732124,
      "mae_dx": 0.011240997351706028,
      "mae_dy": 0.005783563479781151,
      "pose_mae_dtheta": 0.2718620300292969,
      "pose_mae_dx": 0.10917796939611435,
      "pose_mae_dy": 0.08245270699262619,
      "pose_rmse_dtheta": 0.5075492262840271,
      "pose_rmse_dx": 0.2642928957939148,
      "pose_rmse_dy": 0.1680479645729065,
      "pose_rmse_mean": 0.31329670548439026,
      "rmse_dtheta": 0.0501842126250267,
      "rmse_dx": 0.024337464943528175,
      "rmse_dy": 0.011951111257076263,
      "rmse_mean": 0.02882426232099533,
      "rotation_flip": 0.01092896144837141,
      "sparse_tokens": 15717.0,
      "step": 3961,
      "turn_loss": 0.22384245693683624,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.18407359226909498,
      "grad_norm": 0.5707975029945374,
      "learning_rate": 7.635003722673727e-06,
      "loss": 0.1344,
      "mae_dtheta": 0.04017346352338791,
      "mae_dx": 0.00976067315787077,
      "mae_dy": 0.004189360421150923,
      "pose_mae_dtheta": 0.32394254207611084,
      "pose_mae_dx": 0.0712871178984642,
      "pose_mae_dy": 0.029683509841561317,
      "pose_rmse_dtheta": 0.578364372253418,
      "pose_rmse_dx": 0.1596347689628601,
      "pose_rmse_dy": 0.06839268654584885,
      "pose_rmse_mean": 0.26879727840423584,
      "rmse_dtheta": 0.06164189800620079,
      "rmse_dx": 0.02048162929713726,
      "rmse_dy": 0.00979885458946228,
      "rmse_mean": 0.030640793964266777,
      "rotation_flip": 0.01247771829366684,
      "sparse_tokens": 8259.0,
      "step": 3962,
      "turn_loss": 0.2882930636405945,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.18412005203493775,
      "grad_norm": 0.4571464955806732,
      "learning_rate": 7.633879923027717e-06,
      "loss": 0.1106,
      "mae_dtheta": 0.012287789955735207,
      "mae_dx": 0.001843899255618453,
      "mae_dy": 0.0027168497908860445,
      "pose_mae_dtheta": 0.07760009914636612,
      "pose_mae_dx": 0.024433953687548637,
      "pose_mae_dy": 0.02994731441140175,
      "pose_rmse_dtheta": 0.1948993057012558,
      "pose_rmse_dx": 0.05104430392384529,
      "pose_rmse_dy": 0.05944553017616272,
      "pose_rmse_mean": 0.10179638117551804,
      "rmse_dtheta": 0.02502136118710041,
      "rmse_dx": 0.004562381189316511,
      "rmse_dy": 0.00485525606200099,
      "rmse_mean": 0.011479666456580162,
      "rotation_flip": 0.009993338026106358,
      "sparse_tokens": 32105.0,
      "step": 3963,
      "turn_loss": 0.09589866548776627,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18416651180078053,
      "grad_norm": 0.5783600807189941,
      "learning_rate": 7.63275593919307e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.009569560177624226,
      "mae_dx": 0.0012473615352064371,
      "mae_dy": 0.002135019749403,
      "pose_mae_dtheta": 0.0636577159166336,
      "pose_mae_dx": 0.020283766090869904,
      "pose_mae_dy": 0.028016583994030952,
      "pose_rmse_dtheta": 0.141720250248909,
      "pose_rmse_dx": 0.05145345628261566,
      "pose_rmse_dy": 0.06352679431438446,
      "pose_rmse_mean": 0.08556684106588364,
      "rmse_dtheta": 0.020943326875567436,
      "rmse_dx": 0.0036295768804848194,
      "rmse_dy": 0.004501167219132185,
      "rmse_mean": 0.009691357612609863,
      "rotation_flip": 0.0069578662514686584,
      "sparse_tokens": 32089.0,
      "step": 3964,
      "turn_loss": 0.07561039179563522,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.1842129715666233,
      "grad_norm": 0.746917188167572,
      "learning_rate": 7.631631771248387e-06,
      "loss": 0.1623,
      "mae_dtheta": 0.04103218764066696,
      "mae_dx": 0.023810498416423798,
      "mae_dy": 0.006714335177093744,
      "pose_mae_dtheta": 0.38479551672935486,
      "pose_mae_dx": 0.18776577711105347,
      "pose_mae_dy": 0.09283719211816788,
      "pose_rmse_dtheta": 0.6308223605155945,
      "pose_rmse_dx": 0.3543819189071655,
      "pose_rmse_dy": 0.19936224818229675,
      "pose_rmse_mean": 0.3948554992675781,
      "rmse_dtheta": 0.05900929495692253,
      "rmse_dx": 0.03726735711097717,
      "rmse_dy": 0.010593807324767113,
      "rmse_mean": 0.03562349081039429,
      "rotation_flip": 0.004950494971126318,
      "sparse_tokens": 4407.0,
      "step": 3965,
      "turn_loss": 0.373442679643631,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18425943133246608,
      "grad_norm": 0.5565066337585449,
      "learning_rate": 7.630507419272281e-06,
      "loss": 0.1415,
      "mae_dtheta": 0.008395415730774403,
      "mae_dx": 0.0011678625596687198,
      "mae_dy": 0.0021901580039411783,
      "pose_mae_dtheta": 0.05576222762465477,
      "pose_mae_dx": 0.017200706526637077,
      "pose_mae_dy": 0.025756724178791046,
      "pose_rmse_dtheta": 0.12625084817409515,
      "pose_rmse_dx": 0.04250376299023628,
      "pose_rmse_dy": 0.0545676089823246,
      "pose_rmse_mean": 0.07444074004888535,
      "rmse_dtheta": 0.018222758546471596,
      "rmse_dx": 0.0029449465218931437,
      "rmse_dy": 0.004629082046449184,
      "rmse_mean": 0.008598929271101952,
      "rotation_flip": 0.00551314651966095,
      "sparse_tokens": 32057.0,
      "step": 3966,
      "turn_loss": 0.06831149756908417,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.18430589109830886,
      "grad_norm": 0.9930427074432373,
      "learning_rate": 7.629382883343381e-06,
      "loss": 0.1443,
      "mae_dtheta": 0.04589490219950676,
      "mae_dx": 0.0077855694107711315,
      "mae_dy": 0.004939590115100145,
      "pose_mae_dtheta": 0.36260178685188293,
      "pose_mae_dx": 0.06328035891056061,
      "pose_mae_dy": 0.05379106476902962,
      "pose_rmse_dtheta": 0.6169477701187134,
      "pose_rmse_dx": 0.13166354596614838,
      "pose_rmse_dy": 0.12056426703929901,
      "pose_rmse_mean": 0.2897252142429352,
      "rmse_dtheta": 0.06685873121023178,
      "rmse_dx": 0.017234694212675095,
      "rmse_dy": 0.010768190957605839,
      "rmse_mean": 0.03162053972482681,
      "rotation_flip": 0.017676766961812973,
      "sparse_tokens": 6252.0,
      "step": 3967,
      "turn_loss": 0.3116573095321655,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18435235086415164,
      "grad_norm": 0.577574610710144,
      "learning_rate": 7.6282581635403234e-06,
      "loss": 0.1638,
      "mae_dtheta": 0.010282936505973339,
      "mae_dx": 0.002497086301445961,
      "mae_dy": 0.00391354039311409,
      "pose_mae_dtheta": 0.06518948078155518,
      "pose_mae_dx": 0.02665328048169613,
      "pose_mae_dy": 0.027218224480748177,
      "pose_rmse_dtheta": 0.153208389878273,
      "pose_rmse_dx": 0.07159003615379333,
      "pose_rmse_dy": 0.05274079367518425,
      "pose_rmse_mean": 0.0925130769610405,
      "rmse_dtheta": 0.02186932973563671,
      "rmse_dx": 0.0068258545361459255,
      "rmse_dy": 0.00931017566472292,
      "rmse_mean": 0.01266845315694809,
      "rotation_flip": 0.006166122388094664,
      "sparse_tokens": 32089.0,
      "step": 3968,
      "turn_loss": 0.11611181497573853,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.18439881062999441,
      "grad_norm": 0.42753109335899353,
      "learning_rate": 7.627133259941762e-06,
      "loss": 0.095,
      "mae_dtheta": 0.0293886736035347,
      "mae_dx": 0.008462141267955303,
      "mae_dy": 0.0033503130543977022,
      "pose_mae_dtheta": 0.20759636163711548,
      "pose_mae_dx": 0.054025277495384216,
      "pose_mae_dy": 0.037644967436790466,
      "pose_rmse_dtheta": 0.40039411187171936,
      "pose_rmse_dx": 0.12213864922523499,
      "pose_rmse_dy": 0.09143256396055222,
      "pose_rmse_mean": 0.20465511083602905,
      "rmse_dtheta": 0.04866992309689522,
      "rmse_dx": 0.018446821719408035,
      "rmse_dy": 0.006671143230050802,
      "rmse_mean": 0.024595964699983597,
      "rotation_flip": 0.017105262726545334,
      "sparse_tokens": 13181.0,
      "step": 3969,
      "turn_loss": 0.19922932982444763,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.18444527039583722,
      "grad_norm": 0.44392701983451843,
      "learning_rate": 7.626008172626362e-06,
      "loss": 0.1052,
      "mae_dtheta": 0.014102174900472164,
      "mae_dx": 0.0029705294873565435,
      "mae_dy": 0.004496939945966005,
      "pose_mae_dtheta": 0.09960737079381943,
      "pose_mae_dx": 0.036184098571538925,
      "pose_mae_dy": 0.04641234129667282,
      "pose_rmse_dtheta": 0.23069025576114655,
      "pose_rmse_dx": 0.10138663649559021,
      "pose_rmse_dy": 0.10707803070545197,
      "pose_rmse_mean": 0.14638498425483704,
      "rmse_dtheta": 0.026728905737400055,
      "rmse_dx": 0.008386658504605293,
      "rmse_dy": 0.009388945996761322,
      "rmse_mean": 0.01483483612537384,
      "rotation_flip": 0.006005056668072939,
      "sparse_tokens": 32073.0,
      "step": 3970,
      "turn_loss": 0.12525221705436707,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.18449173016168,
      "grad_norm": 0.6993573307991028,
      "learning_rate": 7.624882901672801e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.009185828268527985,
      "mae_dx": 0.0017871733289211988,
      "mae_dy": 0.0014067022129893303,
      "pose_mae_dtheta": 0.06422591209411621,
      "pose_mae_dx": 0.019727302715182304,
      "pose_mae_dy": 0.01720668189227581,
      "pose_rmse_dtheta": 0.20801816880702972,
      "pose_rmse_dx": 0.05025653541088104,
      "pose_rmse_dy": 0.048262275755405426,
      "pose_rmse_mean": 0.10217899084091187,
      "rmse_dtheta": 0.02593338117003441,
      "rmse_dx": 0.005436341278254986,
      "rmse_dy": 0.0035032432060688734,
      "rmse_mean": 0.011624323204159737,
      "rotation_flip": 0.00770712923258543,
      "sparse_tokens": 32153.0,
      "step": 3971,
      "turn_loss": 0.06357712298631668,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18453818992752277,
      "grad_norm": 0.5365122556686401,
      "learning_rate": 7.62375744715977e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.00854844506829977,
      "mae_dx": 0.0019427972147241235,
      "mae_dy": 0.0020233953837305307,
      "pose_mae_dtheta": 0.0625143051147461,
      "pose_mae_dx": 0.025605523958802223,
      "pose_mae_dy": 0.02171209082007408,
      "pose_rmse_dtheta": 0.18994806706905365,
      "pose_rmse_dx": 0.07654862105846405,
      "pose_rmse_dy": 0.054310042411088943,
      "pose_rmse_mean": 0.10693558305501938,
      "rmse_dtheta": 0.022501178085803986,
      "rmse_dx": 0.0069780801422894,
      "rmse_dy": 0.004930317867547274,
      "rmse_mean": 0.011469858698546886,
      "rotation_flip": 0.0023408238776028156,
      "sparse_tokens": 32089.0,
      "step": 3972,
      "turn_loss": 0.06811486929655075,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.18458464969336555,
      "grad_norm": 0.5713269114494324,
      "learning_rate": 7.622631809165972e-06,
      "loss": 0.1441,
      "mae_dtheta": 0.032112814486026764,
      "mae_dx": 0.006662618834525347,
      "mae_dy": 0.0034781263675540686,
      "pose_mae_dtheta": 0.28189972043037415,
      "pose_mae_dx": 0.042545873671770096,
      "pose_mae_dy": 0.022866209968924522,
      "pose_rmse_dtheta": 0.5729210376739502,
      "pose_rmse_dx": 0.09833754599094391,
      "pose_rmse_dy": 0.0608106292784214,
      "pose_rmse_mean": 0.24402306973934174,
      "rmse_dtheta": 0.05714619159698486,
      "rmse_dx": 0.014904513955116272,
      "rmse_dy": 0.008604730479419231,
      "rmse_mean": 0.026885144412517548,
      "rotation_flip": 0.0,
      "sparse_tokens": 3771.0,
      "step": 3973,
      "turn_loss": 0.23280544579029083,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.18463110945920833,
      "grad_norm": 0.5234078764915466,
      "learning_rate": 7.621505987770124e-06,
      "loss": 0.1263,
      "mae_dtheta": 0.00910069327801466,
      "mae_dx": 0.0022115486208349466,
      "mae_dy": 0.000918821373488754,
      "pose_mae_dtheta": 0.06247485429048538,
      "pose_mae_dx": 0.018316419795155525,
      "pose_mae_dy": 0.012014326639473438,
      "pose_rmse_dtheta": 0.19338074326515198,
      "pose_rmse_dx": 0.045083027333021164,
      "pose_rmse_dy": 0.031671687960624695,
      "pose_rmse_mean": 0.09004515409469604,
      "rmse_dtheta": 0.026264259591698647,
      "rmse_dx": 0.006212104577571154,
      "rmse_dy": 0.0023240307345986366,
      "rmse_mean": 0.0116001321002841,
      "rotation_flip": 0.007884971797466278,
      "sparse_tokens": 32201.0,
      "step": 3974,
      "turn_loss": 0.07417774200439453,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33738.0,
      "epoch": 0.1846775692250511,
      "grad_norm": 0.5078577399253845,
      "learning_rate": 7.620379983050955e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.026582518592476845,
      "mae_dx": 0.013149753212928772,
      "mae_dy": 0.0029573929496109486,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5078577995300293,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.08499145507812,
      "model/head/act_norm_mean": 109.02908090444711,
      "model/head/act_norm_min": 60.85666275024414,
      "model/head/act_over_embed": 74.9258051438736,
      "model/head/grad_frac": 0.0945616140961647,
      "model/head/grad_norm": 0.048023853451013565,
      "model/head/grad_zero_frac": 0.00020908209262415767,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6811711237980769,
      "model/head/update_ratio": 0.0008253929554484785,
      "model/head/weight_delta": 7.443591594696045,
      "model/head/weight_delta_rel": 0.13058264553546906,
      "model/head/weight_norm": 58.18301773071289,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41737812757492065,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4173089890252976,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4172450006008148,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2867786441664941,
      "model/modality_embedder.encoders.pose/grad_frac": 0.13655012845993042,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06934804469347,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5319940476190477,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0022462557535618544,
      "model/modality_embedder.encoders.pose/weight_delta": 2.447502851486206,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.07996754348278046,
      "model/modality_embedder.encoders.pose/weight_norm": 30.87272834777832,
      "model/modality_embedder/grad_frac": 0.13655012845993042,
      "model/modality_embedder/grad_norm": 0.06934804469347,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5319940476190477,
      "model/modality_embedder/update_ratio": 0.0022462557535618544,
      "model/modality_embedder/weight_delta": 2.447502851486206,
      "model/modality_embedder/weight_delta_rel": 0.07996754348278046,
      "model/modality_embedder/weight_norm": 30.87272834777832,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.52230072021484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.429544413919412,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.129194259643555,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.101002272096153,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0689510703086853,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.035017337650060654,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012620538473129272,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.740358829498291,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06341972947120667,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.746309280395508,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 82.68074035644531,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.315201942155067,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.540802955627441,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.70963441715611,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07115328311920166,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03613574802875519,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001228551845997572,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.1992135047912598,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07618247717618942,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.413286209106445,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.37980651855469,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.961519383394382,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.980360984802246,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.84099917584249,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07431748509407043,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03774271532893181,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001242927392013371,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.3598198890686035,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07923833280801773,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.365985870361328,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.9286880493164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.84786134004884,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.94137191772461,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.137311028667074,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09142893552780151,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.046432897448539734,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015644646482542157,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.0147132873535156,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06885334104299545,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.67973518371582,
      "model/normalizer/grad_frac": 0.3806566894054413,
      "model/normalizer/grad_norm": 0.19331946969032288,
      "model/normalizer/grad_zero_frac": 0.0002292572462465614,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002470266306772828,
      "model/normalizer/weight_delta": 4.280318737030029,
      "model/normalizer/weight_delta_rel": 0.05512802675366402,
      "model/normalizer/weight_norm": 78.25855255126953,
      "pose_mae_dtheta": 0.19638310372829437,
      "pose_mae_dx": 0.10940084606409073,
      "pose_mae_dy": 0.03661029785871506,
      "pose_rmse_dtheta": 0.34468144178390503,
      "pose_rmse_dx": 0.23734943568706512,
      "pose_rmse_dy": 0.09074121713638306,
      "pose_rmse_mean": 0.22425737977027893,
      "rmse_dtheta": 0.0426146425306797,
      "rmse_dx": 0.025850271806120872,
      "rmse_dy": 0.005733087658882141,
      "rmse_mean": 0.024732667952775955,
      "rotation_flip": 0.006540697533637285,
      "sparse_tokens": 27014.0,
      "step": 3975,
      "turn_loss": 0.23195835947990417,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.18472402899089388,
      "grad_norm": 0.46994224190711975,
      "learning_rate": 7.619253795087209e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.009567512199282646,
      "mae_dx": 0.0014397150371223688,
      "mae_dy": 0.002048322930932045,
      "pose_mae_dtheta": 0.06774544715881348,
      "pose_mae_dx": 0.015456166118383408,
      "pose_mae_dy": 0.02731829136610031,
      "pose_rmse_dtheta": 0.17331652343273163,
      "pose_rmse_dx": 0.04281570389866829,
      "pose_rmse_dy": 0.061986878514289856,
      "pose_rmse_mean": 0.09270636737346649,
      "rmse_dtheta": 0.021264713257551193,
      "rmse_dx": 0.004690402187407017,
      "rmse_dy": 0.004963168874382973,
      "rmse_mean": 0.010306094773113728,
      "rotation_flip": 0.0044843051582574844,
      "sparse_tokens": 32105.0,
      "step": 3976,
      "turn_loss": 0.07411441206932068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.18477048875673666,
      "grad_norm": 0.7142006158828735,
      "learning_rate": 7.618127423957638e-06,
      "loss": 0.2165,
      "mae_dtheta": 0.0412507988512516,
      "mae_dx": 0.010242275893688202,
      "mae_dy": 0.00682865409180522,
      "pose_mae_dtheta": 0.32601669430732727,
      "pose_mae_dx": 0.08580679446458817,
      "pose_mae_dy": 0.056034721434116364,
      "pose_rmse_dtheta": 0.5837388634681702,
      "pose_rmse_dx": 0.1899348795413971,
      "pose_rmse_dy": 0.13981516659259796,
      "pose_rmse_mean": 0.30449631810188293,
      "rmse_dtheta": 0.062207456678152084,
      "rmse_dx": 0.020864242687821388,
      "rmse_dy": 0.016024237498641014,
      "rmse_mean": 0.03303198143839836,
      "rotation_flip": 0.014763014391064644,
      "sparse_tokens": 21356.0,
      "step": 3977,
      "turn_loss": 0.3114907145500183,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.18481694852257943,
      "grad_norm": 1.374936580657959,
      "learning_rate": 7.617000869741011e-06,
      "loss": 0.2841,
      "mae_dtheta": 0.03192796930670738,
      "mae_dx": 0.017716286703944206,
      "mae_dy": 0.006108742672950029,
      "pose_mae_dtheta": 0.2119135707616806,
      "pose_mae_dx": 0.14147095382213593,
      "pose_mae_dy": 0.07634326070547104,
      "pose_rmse_dtheta": 0.33831319212913513,
      "pose_rmse_dx": 0.2767154276371002,
      "pose_rmse_dy": 0.1586599349975586,
      "pose_rmse_mean": 0.25789618492126465,
      "rmse_dtheta": 0.04666709154844284,
      "rmse_dx": 0.03147142380475998,
      "rmse_dy": 0.01045488752424717,
      "rmse_mean": 0.02953113429248333,
      "rotation_flip": 0.016771487891674042,
      "sparse_tokens": 7287.0,
      "step": 3978,
      "turn_loss": 0.24237333238124847,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.18486340828842224,
      "grad_norm": 0.5338234901428223,
      "learning_rate": 7.615874132516108e-06,
      "loss": 0.126,
      "mae_dtheta": 0.006102592218667269,
      "mae_dx": 0.0011961156269535422,
      "mae_dy": 0.0012238676426932216,
      "pose_mae_dtheta": 0.04412588104605675,
      "pose_mae_dx": 0.013021694496273994,
      "pose_mae_dy": 0.020202942192554474,
      "pose_rmse_dtheta": 0.09370224177837372,
      "pose_rmse_dx": 0.036952294409275055,
      "pose_rmse_dy": 0.04924087971448898,
      "pose_rmse_mean": 0.05996514484286308,
      "rmse_dtheta": 0.014463969506323338,
      "rmse_dx": 0.003959920722991228,
      "rmse_dy": 0.0024701713118702173,
      "rmse_mean": 0.006964687258005142,
      "rotation_flip": 0.0014985015150159597,
      "sparse_tokens": 32105.0,
      "step": 3979,
      "turn_loss": 0.05004977807402611,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.18490986805426501,
      "grad_norm": 0.846739649772644,
      "learning_rate": 7.614747212361724e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.009913483634591103,
      "mae_dx": 0.0015987585065886378,
      "mae_dy": 0.0021423615980893373,
      "pose_mae_dtheta": 0.06763675063848495,
      "pose_mae_dx": 0.02288144640624523,
      "pose_mae_dy": 0.028364207595586777,
      "pose_rmse_dtheta": 0.15868307650089264,
      "pose_rmse_dx": 0.05668225884437561,
      "pose_rmse_dy": 0.06638028472661972,
      "pose_rmse_mean": 0.09391520917415619,
      "rmse_dtheta": 0.021468378603458405,
      "rmse_dx": 0.004806237760931253,
      "rmse_dy": 0.004614402540028095,
      "rmse_mean": 0.010296340100467205,
      "rotation_flip": 0.0023847375996410847,
      "sparse_tokens": 32121.0,
      "step": 3980,
      "turn_loss": 0.07925830036401749,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.1849563278201078,
      "grad_norm": 0.5798311829566956,
      "learning_rate": 7.613620109356663e-06,
      "loss": 0.1446,
      "mae_dtheta": 0.030808646231889725,
      "mae_dx": 0.011290645226836205,
      "mae_dy": 0.00354099296964705,
      "pose_mae_dtheta": 0.23991313576698303,
      "pose_mae_dx": 0.10426105558872223,
      "pose_mae_dy": 0.04084641858935356,
      "pose_rmse_dtheta": 0.4312511086463928,
      "pose_rmse_dx": 0.2042606621980667,
      "pose_rmse_dy": 0.09761068969964981,
      "pose_rmse_mean": 0.24437415599822998,
      "rmse_dtheta": 0.050620146095752716,
      "rmse_dx": 0.022593790665268898,
      "rmse_dy": 0.007352583110332489,
      "rmse_mean": 0.026855506002902985,
      "rotation_flip": 0.01123595517128706,
      "sparse_tokens": 10272.0,
      "step": 3981,
      "turn_loss": 0.20278635621070862,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18500278758595057,
      "grad_norm": 0.485382080078125,
      "learning_rate": 7.612492823579744e-06,
      "loss": 0.108,
      "mae_dtheta": 0.011728554032742977,
      "mae_dx": 0.001693211612291634,
      "mae_dy": 0.003771447343751788,
      "pose_mae_dtheta": 0.07418651878833771,
      "pose_mae_dx": 0.029692744836211205,
      "pose_mae_dy": 0.042734235525131226,
      "pose_rmse_dtheta": 0.14573495090007782,
      "pose_rmse_dx": 0.08078527450561523,
      "pose_rmse_dy": 0.10302499681711197,
      "pose_rmse_mean": 0.10984840989112854,
      "rmse_dtheta": 0.0216903667896986,
      "rmse_dx": 0.00451226020231843,
      "rmse_dy": 0.008946833200752735,
      "rmse_mean": 0.011716486886143684,
      "rotation_flip": 0.0010976948542520404,
      "sparse_tokens": 32089.0,
      "step": 3982,
      "turn_loss": 0.10681290179491043,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.18504924735179334,
      "grad_norm": 0.36743077635765076,
      "learning_rate": 7.611365355109802e-06,
      "loss": 0.0845,
      "mae_dtheta": 0.028618700802326202,
      "mae_dx": 0.009369156323373318,
      "mae_dy": 0.004065399989485741,
      "pose_mae_dtheta": 0.21950656175613403,
      "pose_mae_dx": 0.09391067922115326,
      "pose_mae_dy": 0.055108554661273956,
      "pose_rmse_dtheta": 0.43869471549987793,
      "pose_rmse_dx": 0.21836616098880768,
      "pose_rmse_dy": 0.10211427509784698,
      "pose_rmse_mean": 0.25305837392807007,
      "rmse_dtheta": 0.04764439910650253,
      "rmse_dx": 0.02121795155107975,
      "rmse_dy": 0.007344813551753759,
      "rmse_mean": 0.025402387604117393,
      "rotation_flip": 0.0023419202771037817,
      "sparse_tokens": 7709.0,
      "step": 3983,
      "turn_loss": 0.20871400833129883,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.18509570711763612,
      "grad_norm": 0.5738747715950012,
      "learning_rate": 7.610237704025678e-06,
      "loss": 0.1541,
      "mae_dtheta": 0.03732849657535553,
      "mae_dx": 0.013086658902466297,
      "mae_dy": 0.0024639868643134832,
      "pose_mae_dtheta": 0.33164745569229126,
      "pose_mae_dx": 0.09786812961101532,
      "pose_mae_dy": 0.029327938333153725,
      "pose_rmse_dtheta": 0.6180248260498047,
      "pose_rmse_dx": 0.23823757469654083,
      "pose_rmse_dy": 0.07862440496683121,
      "pose_rmse_mean": 0.31162893772125244,
      "rmse_dtheta": 0.058711886405944824,
      "rmse_dx": 0.026556940749287605,
      "rmse_dy": 0.005024852231144905,
      "rmse_mean": 0.03009789250791073,
      "rotation_flip": 0.004608294926583767,
      "sparse_tokens": 4303.0,
      "step": 3984,
      "turn_loss": 0.22735929489135742,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.1851421668834789,
      "grad_norm": 0.6733187437057495,
      "learning_rate": 7.60910987040623e-06,
      "loss": 0.1684,
      "mae_dtheta": 0.031555213034152985,
      "mae_dx": 0.012253561988472939,
      "mae_dy": 0.004285878501832485,
      "pose_mae_dtheta": 0.2409338504076004,
      "pose_mae_dx": 0.09224459528923035,
      "pose_mae_dy": 0.05506143718957901,
      "pose_rmse_dtheta": 0.4402146339416504,
      "pose_rmse_dx": 0.2162376493215561,
      "pose_rmse_dy": 0.1416308730840683,
      "pose_rmse_mean": 0.2660277485847473,
      "rmse_dtheta": 0.04918423667550087,
      "rmse_dx": 0.024821849539875984,
      "rmse_dy": 0.008815957233309746,
      "rmse_mean": 0.027607349678874016,
      "rotation_flip": 0.011904762126505375,
      "sparse_tokens": 26162.0,
      "step": 3985,
      "turn_loss": 0.26321589946746826,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.18518862664932167,
      "grad_norm": 0.641922116279602,
      "learning_rate": 7.60798185433033e-06,
      "loss": 0.1674,
      "mae_dtheta": 0.03215651959180832,
      "mae_dx": 0.009712420403957367,
      "mae_dy": 0.0036640672478824854,
      "pose_mae_dtheta": 0.2375173419713974,
      "pose_mae_dx": 0.0671636313199997,
      "pose_mae_dy": 0.044321250170469284,
      "pose_rmse_dtheta": 0.3858341872692108,
      "pose_rmse_dx": 0.1588945835828781,
      "pose_rmse_dy": 0.10059505701065063,
      "pose_rmse_mean": 0.21510794758796692,
      "rmse_dtheta": 0.04554996266961098,
      "rmse_dx": 0.020320722833275795,
      "rmse_dy": 0.00723605090752244,
      "rmse_mean": 0.02436891198158264,
      "rotation_flip": 0.019505850970745087,
      "sparse_tokens": 12295.0,
      "step": 3986,
      "turn_loss": 0.2417919933795929,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.18523508641516448,
      "grad_norm": 0.7614937424659729,
      "learning_rate": 7.606853655876857e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.023063061758875847,
      "mae_dx": 0.004598274361342192,
      "mae_dy": 0.005111864302307367,
      "pose_mae_dtheta": 0.1672658622264862,
      "pose_mae_dx": 0.033842138946056366,
      "pose_mae_dy": 0.09164602309465408,
      "pose_rmse_dtheta": 0.2718137204647064,
      "pose_rmse_dx": 0.08748898655176163,
      "pose_rmse_dy": 0.1806512326002121,
      "pose_rmse_mean": 0.1799846589565277,
      "rmse_dtheta": 0.0359017513692379,
      "rmse_dx": 0.01420795638114214,
      "rmse_dy": 0.009816300123929977,
      "rmse_mean": 0.019975336268544197,
      "rotation_flip": 0.005115089472383261,
      "sparse_tokens": 8364.0,
      "step": 3987,
      "turn_loss": 0.22616136074066162,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18528154618100726,
      "grad_norm": 0.4652751684188843,
      "learning_rate": 7.605725275124709e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.013361135497689247,
      "mae_dx": 0.0015133883571252227,
      "mae_dy": 0.00271309120580554,
      "pose_mae_dtheta": 0.09409879148006439,
      "pose_mae_dx": 0.022358527407050133,
      "pose_mae_dy": 0.03740876913070679,
      "pose_rmse_dtheta": 0.22385120391845703,
      "pose_rmse_dx": 0.055244699120521545,
      "pose_rmse_dy": 0.07632194459438324,
      "pose_rmse_mean": 0.118472620844841,
      "rmse_dtheta": 0.02629144676029682,
      "rmse_dx": 0.004370822571218014,
      "rmse_dy": 0.005249012727290392,
      "rmse_mean": 0.011970426887273788,
      "rotation_flip": 0.006064930465072393,
      "sparse_tokens": 32057.0,
      "step": 3988,
      "turn_loss": 0.09789680689573288,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.18532800594685003,
      "grad_norm": 0.4955023527145386,
      "learning_rate": 7.604596712152795e-06,
      "loss": 0.1149,
      "mae_dtheta": 0.01099282968789339,
      "mae_dx": 0.0028953147120773792,
      "mae_dy": 0.0027831876650452614,
      "pose_mae_dtheta": 0.07753802090883255,
      "pose_mae_dx": 0.03558095917105675,
      "pose_mae_dy": 0.035609643906354904,
      "pose_rmse_dtheta": 0.17790190875530243,
      "pose_rmse_dx": 0.12236960977315903,
      "pose_rmse_dy": 0.08007006347179413,
      "pose_rmse_mean": 0.12678053975105286,
      "rmse_dtheta": 0.024034962058067322,
      "rmse_dx": 0.009921791031956673,
      "rmse_dy": 0.006795050110667944,
      "rmse_mean": 0.013583933934569359,
      "rotation_flip": 0.004772234242409468,
      "sparse_tokens": 32073.0,
      "step": 3989,
      "turn_loss": 0.10602080821990967,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1853744657126928,
      "grad_norm": 0.4559682011604309,
      "learning_rate": 7.603467967040035e-06,
      "loss": 0.0972,
      "mae_dtheta": 0.010907565243542194,
      "mae_dx": 0.001964509254321456,
      "mae_dy": 0.002470791805535555,
      "pose_mae_dtheta": 0.0695367231965065,
      "pose_mae_dx": 0.0221070796251297,
      "pose_mae_dy": 0.027365079149603844,
      "pose_rmse_dtheta": 0.15822382271289825,
      "pose_rmse_dx": 0.05428576469421387,
      "pose_rmse_dy": 0.05830378830432892,
      "pose_rmse_mean": 0.09027113020420074,
      "rmse_dtheta": 0.022232165560126305,
      "rmse_dx": 0.005647474434226751,
      "rmse_dy": 0.005113069899380207,
      "rmse_mean": 0.010997570119798183,
      "rotation_flip": 0.008669430390000343,
      "sparse_tokens": 32105.0,
      "step": 3990,
      "turn_loss": 0.08693955093622208,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25313.0,
      "epoch": 0.1854209254785356,
      "grad_norm": 0.5474597811698914,
      "learning_rate": 7.602339039865362e-06,
      "loss": 0.163,
      "mae_dtheta": 0.027416430413722992,
      "mae_dx": 0.010227270424365997,
      "mae_dy": 0.004064489621669054,
      "pose_mae_dtheta": 0.1939798891544342,
      "pose_mae_dx": 0.08372145891189575,
      "pose_mae_dy": 0.05334005132317543,
      "pose_rmse_dtheta": 0.3475470244884491,
      "pose_rmse_dx": 0.20658807456493378,
      "pose_rmse_dy": 0.11437999457120895,
      "pose_rmse_mean": 0.2228383719921112,
      "rmse_dtheta": 0.043996550142765045,
      "rmse_dx": 0.023510102182626724,
      "rmse_dy": 0.007622344885021448,
      "rmse_mean": 0.025043001398444176,
      "rotation_flip": 0.011246485635638237,
      "sparse_tokens": 20368.0,
      "step": 3991,
      "turn_loss": 0.26331451535224915,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.18546738524437836,
      "grad_norm": 0.46936556696891785,
      "learning_rate": 7.6012099307077235e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.009943999350070953,
      "mae_dx": 0.002164840465411544,
      "mae_dy": 0.003351914696395397,
      "pose_mae_dtheta": 0.06610463559627533,
      "pose_mae_dx": 0.025158511474728584,
      "pose_mae_dy": 0.028395846486091614,
      "pose_rmse_dtheta": 0.14489388465881348,
      "pose_rmse_dx": 0.06548123806715012,
      "pose_rmse_dy": 0.06314045935869217,
      "pose_rmse_mean": 0.09117186069488525,
      "rmse_dtheta": 0.020118460059165955,
      "rmse_dx": 0.006325036287307739,
      "rmse_dy": 0.008211041800677776,
      "rmse_mean": 0.011551513336598873,
      "rotation_flip": 0.0036319612991064787,
      "sparse_tokens": 32073.0,
      "step": 3992,
      "turn_loss": 0.08959323912858963,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.18551384501022114,
      "grad_norm": 0.5987450480461121,
      "learning_rate": 7.600080639646077e-06,
      "loss": 0.1347,
      "mae_dtheta": 0.011702407151460648,
      "mae_dx": 0.002360316226258874,
      "mae_dy": 0.0034450297243893147,
      "pose_mae_dtheta": 0.08168137073516846,
      "pose_mae_dx": 0.032192159444093704,
      "pose_mae_dy": 0.038511212915182114,
      "pose_rmse_dtheta": 0.1768161654472351,
      "pose_rmse_dx": 0.08191537111997604,
      "pose_rmse_dy": 0.10078960657119751,
      "pose_rmse_mean": 0.11984038352966309,
      "rmse_dtheta": 0.022521138191223145,
      "rmse_dx": 0.00633862754330039,
      "rmse_dy": 0.008284644223749638,
      "rmse_mean": 0.012381470762193203,
      "rotation_flip": 0.004854368977248669,
      "sparse_tokens": 32121.0,
      "step": 3993,
      "turn_loss": 0.09720344841480255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.18556030477606392,
      "grad_norm": 0.5885573029518127,
      "learning_rate": 7.598951166759398e-06,
      "loss": 0.1495,
      "mae_dtheta": 0.028060942888259888,
      "mae_dx": 0.008110417984426022,
      "mae_dy": 0.0037196988705545664,
      "pose_mae_dtheta": 0.2298598736524582,
      "pose_mae_dx": 0.06725192815065384,
      "pose_mae_dy": 0.037735868245363235,
      "pose_rmse_dtheta": 0.4281415343284607,
      "pose_rmse_dx": 0.1809893250465393,
      "pose_rmse_dy": 0.08008671551942825,
      "pose_rmse_mean": 0.22973918914794922,
      "rmse_dtheta": 0.04966751113533974,
      "rmse_dx": 0.020008057355880737,
      "rmse_dy": 0.008404377847909927,
      "rmse_mean": 0.0260266475379467,
      "rotation_flip": 0.011695906519889832,
      "sparse_tokens": 3666.0,
      "step": 3994,
      "turn_loss": 0.1702130138874054,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.18560676454190672,
      "grad_norm": 0.6095844507217407,
      "learning_rate": 7.597821512126668e-06,
      "loss": 0.1427,
      "mae_dtheta": 0.007380782626569271,
      "mae_dx": 0.0014269171515479684,
      "mae_dy": 0.0006564768264070153,
      "pose_mae_dtheta": 0.053656257688999176,
      "pose_mae_dx": 0.012053024023771286,
      "pose_mae_dy": 0.008871517144143581,
      "pose_rmse_dtheta": 0.21635550260543823,
      "pose_rmse_dx": 0.03037475049495697,
      "pose_rmse_dy": 0.020902620628476143,
      "pose_rmse_mean": 0.08921095728874207,
      "rmse_dtheta": 0.02525276318192482,
      "rmse_dx": 0.004281178582459688,
      "rmse_dy": 0.0012976910220459104,
      "rmse_mean": 0.010277211666107178,
      "rotation_flip": 0.0022055581212043762,
      "sparse_tokens": 32201.0,
      "step": 3995,
      "turn_loss": 0.04860436171293259,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.1856532243077495,
      "grad_norm": 0.5540160536766052,
      "learning_rate": 7.596691675826886e-06,
      "loss": 0.106,
      "mae_dtheta": 0.04151586443185806,
      "mae_dx": 0.01440549548715353,
      "mae_dy": 0.003255329793319106,
      "pose_mae_dtheta": 0.36402255296707153,
      "pose_mae_dx": 0.12885035574436188,
      "pose_mae_dy": 0.052437081933021545,
      "pose_rmse_dtheta": 0.6361573338508606,
      "pose_rmse_dx": 0.28764209151268005,
      "pose_rmse_dy": 0.12084248661994934,
      "pose_rmse_mean": 0.34821397066116333,
      "rmse_dtheta": 0.06129385158419609,
      "rmse_dx": 0.028493408113718033,
      "rmse_dy": 0.005929738748818636,
      "rmse_mean": 0.03190566599369049,
      "rotation_flip": 0.008333333767950535,
      "sparse_tokens": 8107.0,
      "step": 3996,
      "turn_loss": 0.2928134799003601,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.18569968407359227,
      "grad_norm": 0.5876386761665344,
      "learning_rate": 7.595561657939061e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.010032488964498043,
      "mae_dx": 0.003571899142116308,
      "mae_dy": 0.003575440961867571,
      "pose_mae_dtheta": 0.0659828782081604,
      "pose_mae_dx": 0.03718817979097366,
      "pose_mae_dy": 0.02892877534031868,
      "pose_rmse_dtheta": 0.14333097636699677,
      "pose_rmse_dx": 0.1096404567360878,
      "pose_rmse_dy": 0.0656094029545784,
      "pose_rmse_mean": 0.10619361698627472,
      "rmse_dtheta": 0.020765457302331924,
      "rmse_dx": 0.010551946237683296,
      "rmse_dy": 0.00946721900254488,
      "rmse_mean": 0.013594875112175941,
      "rotation_flip": 0.00325203244574368,
      "sparse_tokens": 32169.0,
      "step": 3997,
      "turn_loss": 0.11079587787389755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.18574614383943505,
      "grad_norm": 0.6559280753135681,
      "learning_rate": 7.5944314585422155e-06,
      "loss": 0.1482,
      "mae_dtheta": 0.011941080912947655,
      "mae_dx": 0.0030741123482584953,
      "mae_dy": 0.0026990396436303854,
      "pose_mae_dtheta": 0.09137838333845139,
      "pose_mae_dx": 0.0340384840965271,
      "pose_mae_dy": 0.03596799820661545,
      "pose_rmse_dtheta": 0.24770590662956238,
      "pose_rmse_dx": 0.08619806170463562,
      "pose_rmse_dy": 0.09853855520486832,
      "pose_rmse_mean": 0.14414751529693604,
      "rmse_dtheta": 0.0292588472366333,
      "rmse_dx": 0.00814807042479515,
      "rmse_dy": 0.007157181855291128,
      "rmse_mean": 0.01485469937324524,
      "rotation_flip": 0.002632733667269349,
      "sparse_tokens": 32121.0,
      "step": 3998,
      "turn_loss": 0.11266431212425232,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.18579260360527783,
      "grad_norm": 0.4715673327445984,
      "learning_rate": 7.593301077715386e-06,
      "loss": 0.1369,
      "mae_dtheta": 0.012684590183198452,
      "mae_dx": 0.002127980813384056,
      "mae_dy": 0.0026234504766762257,
      "pose_mae_dtheta": 0.09084943681955338,
      "pose_mae_dx": 0.02722100168466568,
      "pose_mae_dy": 0.034393925219774246,
      "pose_rmse_dtheta": 0.21102778613567352,
      "pose_rmse_dx": 0.06338382512331009,
      "pose_rmse_dy": 0.0823855847120285,
      "pose_rmse_mean": 0.11893241107463837,
      "rmse_dtheta": 0.025970611721277237,
      "rmse_dx": 0.005681018345057964,
      "rmse_dy": 0.005310239735990763,
      "rmse_mean": 0.01232062466442585,
      "rotation_flip": 0.0063739377073943615,
      "sparse_tokens": 32153.0,
      "step": 3999,
      "turn_loss": 0.09856254607439041,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.1858390633711206,
      "grad_norm": 0.7451447248458862,
      "learning_rate": 7.59217051553762e-06,
      "loss": 0.1543,
      "mae_dtheta": 0.0447784960269928,
      "mae_dx": 0.012894022278487682,
      "mae_dy": 0.007131747901439667,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.745144784450531,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.32064819335938,
      "model/head/act_norm_mean": 111.08694797092014,
      "model/head/act_norm_min": 91.17860412597656,
      "model/head/act_over_embed": 76.33999065800889,
      "model/head/grad_frac": 0.0893007442355156,
      "model/head/grad_norm": 0.06654198467731476,
      "model/head/grad_zero_frac": 0.00013833049160894006,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6892361111111112,
      "model/head/update_ratio": 0.001143564353697002,
      "model/head/weight_delta": 7.467362880706787,
      "model/head/weight_delta_rel": 0.13099966943264008,
      "model/head/weight_norm": 58.188228607177734,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41756007075309753,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41756007075309753,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41756007075309753,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2869511898805024,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0641847550868988,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04782693460583687,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015490464866161346,
      "model/modality_embedder.encoders.pose/weight_delta": 2.4548535346984863,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0802077129483223,
      "model/modality_embedder.encoders.pose/weight_norm": 30.875080108642578,
      "model/modality_embedder/grad_frac": 0.0641847550868988,
      "model/modality_embedder/grad_norm": 0.04782693460583687,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0015490464866161346,
      "model/modality_embedder/weight_delta": 2.4548535346984863,
      "model/modality_embedder/weight_delta_rel": 0.0802077129483223,
      "model/modality_embedder/weight_norm": 30.875080108642578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 69.57257843017578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.68651138117284,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.40400505065918,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.277592377755358,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08530628681182861,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06356553733348846,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002290798583999276,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.7486389875411987,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06372146308422089,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.748201370239258,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 70.962646484375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.552317570546737,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.844483375549316,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.872582496898357,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.077057383954525,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.057418908923864365,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001951938378624618,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.209656238555908,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07654421776533127,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.416353225708008,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 72.61809539794922,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.20343674217372,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.333234786987305,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.007247049661647,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08682039380073547,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06469376385211945,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002130229491740465,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.3712470531463623,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07962203770875931,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.369388580322266,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 73.07855224609375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.194422054122576,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.11652946472168,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.37547079593107,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08837096393108368,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06584916263818741,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022185477428138256,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.0240581035614014,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.069172702729702,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.681201934814453,
      "model/normalizer/grad_frac": 0.35671719908714294,
      "model/normalizer/grad_norm": 0.2658059597015381,
      "model/normalizer/grad_zero_frac": 0.0001571712055010721,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003396356711164117,
      "model/normalizer/weight_delta": 4.300779342651367,
      "model/normalizer/weight_delta_rel": 0.055391546338796616,
      "model/normalizer/weight_norm": 78.2620849609375,
      "pose_mae_dtheta": 0.3476279377937317,
      "pose_mae_dx": 0.09466636925935745,
      "pose_mae_dy": 0.06401961296796799,
      "pose_rmse_dtheta": 0.5975900888442993,
      "pose_rmse_dx": 0.2437778115272522,
      "pose_rmse_dy": 0.15374702215194702,
      "pose_rmse_mean": 0.3317049741744995,
      "rmse_dtheta": 0.06290749460458755,
      "rmse_dx": 0.024873465299606323,
      "rmse_dy": 0.015335003845393658,
      "rmse_mean": 0.034371986985206604,
      "rotation_flip": 0.02238805964589119,
      "sparse_tokens": 4676.0,
      "step": 4000,
      "turn_loss": 0.33615338802337646,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "epoch": 0.1858390633711206,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3134075999259949,
      "eval_objectnav_nopose_mae_dtheta": 0.04001893475651741,
      "eval_objectnav_nopose_mae_dx": 0.013643507845699787,
      "eval_objectnav_nopose_mae_dy": 0.004793480038642883,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3214348256587982,
      "eval_objectnav_nopose_pose_mae_dx": 0.11026310920715332,
      "eval_objectnav_nopose_pose_mae_dy": 0.054155297577381134,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5400471091270447,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23756983876228333,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12701065838336945,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3015425503253937,
      "eval_objectnav_nopose_rmse_dtheta": 0.057714324444532394,
      "eval_objectnav_nopose_rmse_dx": 0.026268137618899345,
      "eval_objectnav_nopose_rmse_dy": 0.009798604063689709,
      "eval_objectnav_nopose_rmse_mean": 0.031260356307029724,
      "eval_objectnav_nopose_rotation_flip": 0.014152375981211662,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3134075999259949,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 4000
    },
    {
      "epoch": 0.1858390633711206,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2852219045162201,
      "eval_objectnav_pose_mae_dtheta": 0.0360814705491066,
      "eval_objectnav_pose_mae_dx": 0.012156147509813309,
      "eval_objectnav_pose_mae_dy": 0.004499652422964573,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27824175357818604,
      "eval_objectnav_pose_pose_mae_dx": 0.09638553112745285,
      "eval_objectnav_pose_pose_mae_dy": 0.048513222485780716,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4847714602947235,
      "eval_objectnav_pose_pose_rmse_dx": 0.2173381894826889,
      "eval_objectnav_pose_pose_rmse_dy": 0.11690767109394073,
      "eval_objectnav_pose_pose_rmse_mean": 0.27300578355789185,
      "eval_objectnav_pose_rmse_dtheta": 0.05370432138442993,
      "eval_objectnav_pose_rmse_dx": 0.02454935573041439,
      "eval_objectnav_pose_rmse_dy": 0.009510863572359085,
      "eval_objectnav_pose_rmse_mean": 0.02925485000014305,
      "eval_objectnav_pose_rotation_flip": 0.014085915870964527,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2852219045162201,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 4000
    },
    {
      "epoch": 0.1858390633711206,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10021912306547165,
      "eval_pointnav_mae_dtheta": 0.010883121751248837,
      "eval_pointnav_mae_dx": 0.002717176452279091,
      "eval_pointnav_mae_dy": 0.0026022614911198616,
      "eval_pointnav_pose_mae_dtheta": 0.07746455073356628,
      "eval_pointnav_pose_mae_dx": 0.030342379584908485,
      "eval_pointnav_pose_mae_dy": 0.02884550206363201,
      "eval_pointnav_pose_rmse_dtheta": 0.21261104941368103,
      "eval_pointnav_pose_rmse_dx": 0.08973813056945801,
      "eval_pointnav_pose_rmse_dy": 0.0858106017112732,
      "eval_pointnav_pose_rmse_mean": 0.12938660383224487,
      "eval_pointnav_rmse_dtheta": 0.026040688157081604,
      "eval_pointnav_rmse_dx": 0.008151266723871231,
      "eval_pointnav_rmse_dy": 0.007094874046742916,
      "eval_pointnav_rmse_mean": 0.013762276619672775,
      "eval_pointnav_rotation_flip": 0.004632241558283567,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10021912306547165,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 4000
    },
    {
      "epoch": 0.1858390633711206,
      "eval_loss": 0.2329495425025622,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3134075999259949,
      "eval_objectnav_nopose_mae_dtheta": 0.04001893475651741,
      "eval_objectnav_nopose_mae_dx": 0.013643507845699787,
      "eval_objectnav_nopose_mae_dy": 0.004793480038642883,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3214348256587982,
      "eval_objectnav_nopose_pose_mae_dx": 0.11026310920715332,
      "eval_objectnav_nopose_pose_mae_dy": 0.054155297577381134,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5400471091270447,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23756983876228333,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12701065838336945,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3015425503253937,
      "eval_objectnav_nopose_rmse_dtheta": 0.057714324444532394,
      "eval_objectnav_nopose_rmse_dx": 0.026268137618899345,
      "eval_objectnav_nopose_rmse_dy": 0.009798604063689709,
      "eval_objectnav_nopose_rmse_mean": 0.031260356307029724,
      "eval_objectnav_nopose_rotation_flip": 0.014152375981211662,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3134075999259949,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2852219045162201,
      "eval_objectnav_pose_mae_dtheta": 0.0360814705491066,
      "eval_objectnav_pose_mae_dx": 0.012156147509813309,
      "eval_objectnav_pose_mae_dy": 0.004499652422964573,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27824175357818604,
      "eval_objectnav_pose_pose_mae_dx": 0.09638553112745285,
      "eval_objectnav_pose_pose_mae_dy": 0.048513222485780716,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4847714602947235,
      "eval_objectnav_pose_pose_rmse_dx": 0.2173381894826889,
      "eval_objectnav_pose_pose_rmse_dy": 0.11690767109394073,
      "eval_objectnav_pose_pose_rmse_mean": 0.27300578355789185,
      "eval_objectnav_pose_rmse_dtheta": 0.05370432138442993,
      "eval_objectnav_pose_rmse_dx": 0.02454935573041439,
      "eval_objectnav_pose_rmse_dy": 0.009510863572359085,
      "eval_objectnav_pose_rmse_mean": 0.02925485000014305,
      "eval_objectnav_pose_rotation_flip": 0.014085915870964527,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2852219045162201,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.10021912306547165,
      "eval_pointnav_mae_dtheta": 0.010883121751248837,
      "eval_pointnav_mae_dx": 0.002717176452279091,
      "eval_pointnav_mae_dy": 0.0026022614911198616,
      "eval_pointnav_pose_mae_dtheta": 0.07746455073356628,
      "eval_pointnav_pose_mae_dx": 0.030342379584908485,
      "eval_pointnav_pose_mae_dy": 0.02884550206363201,
      "eval_pointnav_pose_rmse_dtheta": 0.21261104941368103,
      "eval_pointnav_pose_rmse_dx": 0.08973813056945801,
      "eval_pointnav_pose_rmse_dy": 0.0858106017112732,
      "eval_pointnav_pose_rmse_mean": 0.12938660383224487,
      "eval_pointnav_rmse_dtheta": 0.026040688157081604,
      "eval_pointnav_rmse_dx": 0.008151266723871231,
      "eval_pointnav_rmse_dy": 0.007094874046742916,
      "eval_pointnav_rmse_mean": 0.013762276619672775,
      "eval_pointnav_rotation_flip": 0.004632241558283567,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.10021912306547165,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 4000
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.18588552313696338,
      "grad_norm": 0.46628639101982117,
      "learning_rate": 7.5910397720879785e-06,
      "loss": 0.104,
      "mae_dtheta": 0.010453127324581146,
      "mae_dx": 0.002625437220558524,
      "mae_dy": 0.0020194214303046465,
      "pose_mae_dtheta": 0.07612266391515732,
      "pose_mae_dx": 0.028836188837885857,
      "pose_mae_dy": 0.029449336230754852,
      "pose_rmse_dtheta": 0.19195935130119324,
      "pose_rmse_dx": 0.06703335791826248,
      "pose_rmse_dy": 0.0770132839679718,
      "pose_rmse_mean": 0.11200200021266937,
      "rmse_dtheta": 0.02305203303694725,
      "rmse_dx": 0.00786809716373682,
      "rmse_dy": 0.005131784826517105,
      "rmse_mean": 0.012017305009067059,
      "rotation_flip": 0.003572846297174692,
      "sparse_tokens": 32169.0,
      "step": 4001,
      "turn_loss": 0.0930151492357254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.18593198290280616,
      "grad_norm": 0.45958656072616577,
      "learning_rate": 7.5899088474455355e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.03737284243106842,
      "mae_dx": 0.0104625653475523,
      "mae_dy": 0.005739844869822264,
      "pose_mae_dtheta": 0.2875850796699524,
      "pose_mae_dx": 0.08432226628065109,
      "pose_mae_dy": 0.07548043131828308,
      "pose_rmse_dtheta": 0.5116407871246338,
      "pose_rmse_dx": 0.17840155959129333,
      "pose_rmse_dy": 0.20886193215847015,
      "pose_rmse_mean": 0.29963478446006775,
      "rmse_dtheta": 0.056899700313806534,
      "rmse_dx": 0.022028647363185883,
      "rmse_dy": 0.012994825839996338,
      "rmse_mean": 0.030641060322523117,
      "rotation_flip": 0.012195121496915817,
      "sparse_tokens": 21240.0,
      "step": 4002,
      "turn_loss": 0.2716805338859558,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.18597844266864896,
      "grad_norm": 0.7240360975265503,
      "learning_rate": 7.588777741689376e-06,
      "loss": 0.2134,
      "mae_dtheta": 0.038890540599823,
      "mae_dx": 0.010997583158314228,
      "mae_dy": 0.005220570135861635,
      "pose_mae_dtheta": 0.3012978136539459,
      "pose_mae_dx": 0.09176793694496155,
      "pose_mae_dy": 0.05407007038593292,
      "pose_rmse_dtheta": 0.5521426796913147,
      "pose_rmse_dx": 0.20080453157424927,
      "pose_rmse_dy": 0.13653382658958435,
      "pose_rmse_mean": 0.2964937090873718,
      "rmse_dtheta": 0.059501200914382935,
      "rmse_dx": 0.022100863978266716,
      "rmse_dy": 0.010793641209602356,
      "rmse_mean": 0.030798569321632385,
      "rotation_flip": 0.006458557676523924,
      "sparse_tokens": 13710.0,
      "step": 4003,
      "turn_loss": 0.28581538796424866,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.18602490243449174,
      "grad_norm": 0.62996506690979,
      "learning_rate": 7.5876464548986005e-06,
      "loss": 0.2031,
      "mae_dtheta": 0.03161068260669708,
      "mae_dx": 0.009738501161336899,
      "mae_dy": 0.010676695965230465,
      "pose_mae_dtheta": 0.26018548011779785,
      "pose_mae_dx": 0.11235834658145905,
      "pose_mae_dy": 0.15660357475280762,
      "pose_rmse_dtheta": 0.4159976840019226,
      "pose_rmse_dx": 0.24406151473522186,
      "pose_rmse_dy": 0.29425570368766785,
      "pose_rmse_mean": 0.31810498237609863,
      "rmse_dtheta": 0.04477386176586151,
      "rmse_dx": 0.022690823301672935,
      "rmse_dy": 0.018137115985155106,
      "rmse_mean": 0.028533935546875,
      "rotation_flip": 0.019027484580874443,
      "sparse_tokens": 8370.0,
      "step": 4004,
      "turn_loss": 0.30970197916030884,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18607136220033452,
      "grad_norm": 0.45247963070869446,
      "learning_rate": 7.586514987152318e-06,
      "loss": 0.0863,
      "mae_dtheta": 0.0093713803216815,
      "mae_dx": 0.0016929544508457184,
      "mae_dy": 0.0021378169767558575,
      "pose_mae_dtheta": 0.064173124730587,
      "pose_mae_dx": 0.02087252214550972,
      "pose_mae_dy": 0.026336556300520897,
      "pose_rmse_dtheta": 0.15155574679374695,
      "pose_rmse_dx": 0.05714590102434158,
      "pose_rmse_dy": 0.059333767741918564,
      "pose_rmse_mean": 0.08934514224529266,
      "rmse_dtheta": 0.020557085052132607,
      "rmse_dx": 0.005278154741972685,
      "rmse_dy": 0.004463320132344961,
      "rmse_mean": 0.010099520906805992,
      "rotation_flip": 0.003786285175010562,
      "sparse_tokens": 32057.0,
      "step": 4005,
      "turn_loss": 0.08686891943216324,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1861178219661773,
      "grad_norm": 0.5561966300010681,
      "learning_rate": 7.5853833385296545e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.009747348725795746,
      "mae_dx": 0.0012950124219059944,
      "mae_dy": 0.0023293429985642433,
      "pose_mae_dtheta": 0.06690593808889389,
      "pose_mae_dx": 0.019262438639998436,
      "pose_mae_dy": 0.029691020026803017,
      "pose_rmse_dtheta": 0.16951920092105865,
      "pose_rmse_dx": 0.04631292447447777,
      "pose_rmse_dy": 0.06388133764266968,
      "pose_rmse_mean": 0.09323781728744507,
      "rmse_dtheta": 0.020410241559147835,
      "rmse_dx": 0.0038850263226777315,
      "rmse_dy": 0.004778195172548294,
      "rmse_mean": 0.009691154584288597,
      "rotation_flip": 0.005363984499126673,
      "sparse_tokens": 32057.0,
      "step": 4006,
      "turn_loss": 0.07768385112285614,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.18616428173202007,
      "grad_norm": 0.6011572480201721,
      "learning_rate": 7.584251509109748e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.008326374925673008,
      "mae_dx": 0.0015619337791576982,
      "mae_dy": 0.0017042574472725391,
      "pose_mae_dtheta": 0.052918337285518646,
      "pose_mae_dx": 0.021138932555913925,
      "pose_mae_dy": 0.022417187690734863,
      "pose_rmse_dtheta": 0.15579023957252502,
      "pose_rmse_dx": 0.05113953351974487,
      "pose_rmse_dy": 0.05497310683131218,
      "pose_rmse_mean": 0.08730095624923706,
      "rmse_dtheta": 0.019715063273906708,
      "rmse_dx": 0.004423959646373987,
      "rmse_dy": 0.0038874750025570393,
      "rmse_mean": 0.009342165663838387,
      "rotation_flip": 0.001833516638725996,
      "sparse_tokens": 32169.0,
      "step": 4007,
      "turn_loss": 0.06525598466396332,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.18621074149786285,
      "grad_norm": 0.6906782984733582,
      "learning_rate": 7.583119498971745e-06,
      "loss": 0.1832,
      "mae_dtheta": 0.03786341845989227,
      "mae_dx": 0.013374391943216324,
      "mae_dy": 0.00698850117623806,
      "pose_mae_dtheta": 0.3182881474494934,
      "pose_mae_dx": 0.09836774319410324,
      "pose_mae_dy": 0.07999219000339508,
      "pose_rmse_dtheta": 0.5252735614776611,
      "pose_rmse_dx": 0.19230833649635315,
      "pose_rmse_dy": 0.1971118003129959,
      "pose_rmse_mean": 0.30489790439605713,
      "rmse_dtheta": 0.05530939996242523,
      "rmse_dx": 0.02552753873169422,
      "rmse_dy": 0.015496186912059784,
      "rmse_mean": 0.032111041247844696,
      "rotation_flip": 0.024752475321292877,
      "sparse_tokens": 15569.0,
      "step": 4008,
      "turn_loss": 0.3820761740207672,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18625720126370562,
      "grad_norm": 0.44008445739746094,
      "learning_rate": 7.5819873081948105e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.014241012744605541,
      "mae_dx": 0.00384133099578321,
      "mae_dy": 0.006324815563857555,
      "pose_mae_dtheta": 0.10893934220075607,
      "pose_mae_dx": 0.05378114804625511,
      "pose_mae_dy": 0.053575653582811356,
      "pose_rmse_dtheta": 0.22048604488372803,
      "pose_rmse_dx": 0.14319351315498352,
      "pose_rmse_dy": 0.12556834518909454,
      "pose_rmse_mean": 0.16308264434337616,
      "rmse_dtheta": 0.0256844162940979,
      "rmse_dx": 0.009242336265742779,
      "rmse_dy": 0.012944867834448814,
      "rmse_mean": 0.01595720648765564,
      "rotation_flip": 0.006221915129572153,
      "sparse_tokens": 32089.0,
      "step": 4009,
      "turn_loss": 0.13064219057559967,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.1863036610295484,
      "grad_norm": 0.8485944271087646,
      "learning_rate": 7.580854936858116e-06,
      "loss": 0.1361,
      "mae_dtheta": 0.030383706092834473,
      "mae_dx": 0.012181257829070091,
      "mae_dy": 0.006998055148869753,
      "pose_mae_dtheta": 0.2233162671327591,
      "pose_mae_dx": 0.09982485324144363,
      "pose_mae_dy": 0.09089000523090363,
      "pose_rmse_dtheta": 0.3939022123813629,
      "pose_rmse_dx": 0.23409423232078552,
      "pose_rmse_dy": 0.16501249372959137,
      "pose_rmse_mean": 0.26433631777763367,
      "rmse_dtheta": 0.04470045119524002,
      "rmse_dx": 0.025369567796587944,
      "rmse_dy": 0.010830777697265148,
      "rmse_mean": 0.02696693316102028,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 8110.0,
      "step": 4010,
      "turn_loss": 0.284883052110672,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.18635012079539118,
      "grad_norm": 0.49210602045059204,
      "learning_rate": 7.579722385040852e-06,
      "loss": 0.1425,
      "mae_dtheta": 0.029583152383565903,
      "mae_dx": 0.011485308408737183,
      "mae_dy": 0.00552561366930604,
      "pose_mae_dtheta": 0.2260955572128296,
      "pose_mae_dx": 0.10111618787050247,
      "pose_mae_dy": 0.08643423020839691,
      "pose_rmse_dtheta": 0.4007819592952728,
      "pose_rmse_dx": 0.24227893352508545,
      "pose_rmse_dy": 0.1706034392118454,
      "pose_rmse_mean": 0.27122145891189575,
      "rmse_dtheta": 0.04515577480196953,
      "rmse_dx": 0.025761796161532402,
      "rmse_dy": 0.010417567566037178,
      "rmse_mean": 0.027111712843179703,
      "rotation_flip": 0.012882447801530361,
      "sparse_tokens": 13031.0,
      "step": 4011,
      "turn_loss": 0.22383132576942444,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.18639658056123398,
      "grad_norm": 0.5687006711959839,
      "learning_rate": 7.578589652822215e-06,
      "loss": 0.1793,
      "mae_dtheta": 0.030203623697161674,
      "mae_dx": 0.011112614534795284,
      "mae_dy": 0.008573615923523903,
      "pose_mae_dtheta": 0.2084750235080719,
      "pose_mae_dx": 0.08584579825401306,
      "pose_mae_dy": 0.10066016763448715,
      "pose_rmse_dtheta": 0.3448432981967926,
      "pose_rmse_dx": 0.17997042834758759,
      "pose_rmse_dy": 0.20786041021347046,
      "pose_rmse_mean": 0.24422471225261688,
      "rmse_dtheta": 0.045673128217458725,
      "rmse_dx": 0.02290196903049946,
      "rmse_dy": 0.01462798286229372,
      "rmse_mean": 0.027734361588954926,
      "rotation_flip": 0.013953488320112228,
      "sparse_tokens": 21106.0,
      "step": 4012,
      "turn_loss": 0.3340509831905365,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18644304032707676,
      "grad_norm": 0.45003122091293335,
      "learning_rate": 7.5774567402814225e-06,
      "loss": 0.1,
      "mae_dtheta": 0.006819970905780792,
      "mae_dx": 0.0014429752482101321,
      "mae_dy": 0.001998083433136344,
      "pose_mae_dtheta": 0.04574321210384369,
      "pose_mae_dx": 0.017310064285993576,
      "pose_mae_dy": 0.022313904017210007,
      "pose_rmse_dtheta": 0.11475760489702225,
      "pose_rmse_dx": 0.054935116320848465,
      "pose_rmse_dy": 0.059568051248788834,
      "pose_rmse_mean": 0.07642026245594025,
      "rmse_dtheta": 0.01676877588033676,
      "rmse_dx": 0.004974542185664177,
      "rmse_dy": 0.0049982196651399136,
      "rmse_mean": 0.00891384668648243,
      "rotation_flip": 0.004065040498971939,
      "sparse_tokens": 32057.0,
      "step": 4013,
      "turn_loss": 0.060291536152362823,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.18648950009291954,
      "grad_norm": 0.38125988841056824,
      "learning_rate": 7.576323647497694e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.011392153799533844,
      "mae_dx": 0.0028067012317478657,
      "mae_dy": 0.0027841392438858747,
      "pose_mae_dtheta": 0.08334941416978836,
      "pose_mae_dx": 0.02519974485039711,
      "pose_mae_dy": 0.02993544191122055,
      "pose_rmse_dtheta": 0.17947177588939667,
      "pose_rmse_dx": 0.06385663151741028,
      "pose_rmse_dy": 0.06524665653705597,
      "pose_rmse_mean": 0.10285835713148117,
      "rmse_dtheta": 0.024666596204042435,
      "rmse_dx": 0.00881177932024002,
      "rmse_dy": 0.007782758679240942,
      "rmse_mean": 0.013753711245954037,
      "rotation_flip": 0.00486344937235117,
      "sparse_tokens": 32137.0,
      "step": 4014,
      "turn_loss": 0.10849019885063171,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.1865359598587623,
      "grad_norm": 0.5833180546760559,
      "learning_rate": 7.575190374550272e-06,
      "loss": 0.1138,
      "mae_dtheta": 0.012126986868679523,
      "mae_dx": 0.0028300858102738857,
      "mae_dy": 0.0028655061032623053,
      "pose_mae_dtheta": 0.08726953715085983,
      "pose_mae_dx": 0.030200742185115814,
      "pose_mae_dy": 0.027904653921723366,
      "pose_rmse_dtheta": 0.2180442214012146,
      "pose_rmse_dx": 0.07785818725824356,
      "pose_rmse_dy": 0.0626348927617073,
      "pose_rmse_mean": 0.11951243132352829,
      "rmse_dtheta": 0.026223916560411453,
      "rmse_dx": 0.007913357578217983,
      "rmse_dy": 0.007212680298835039,
      "rmse_mean": 0.013783318921923637,
      "rotation_flip": 0.008873457089066505,
      "sparse_tokens": 32185.0,
      "step": 4015,
      "turn_loss": 0.10077288746833801,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1865824196246051,
      "grad_norm": 0.33579719066619873,
      "learning_rate": 7.5740569215184044e-06,
      "loss": 0.0981,
      "mae_dtheta": 0.012908793054521084,
      "mae_dx": 0.0019955234602093697,
      "mae_dy": 0.0031837557908147573,
      "pose_mae_dtheta": 0.0871041864156723,
      "pose_mae_dx": 0.02645619958639145,
      "pose_mae_dy": 0.03467945754528046,
      "pose_rmse_dtheta": 0.17859575152397156,
      "pose_rmse_dx": 0.06844005733728409,
      "pose_rmse_dy": 0.07379813492298126,
      "pose_rmse_mean": 0.10694464296102524,
      "rmse_dtheta": 0.023080110549926758,
      "rmse_dx": 0.0061868405900895596,
      "rmse_dy": 0.006160845514386892,
      "rmse_mean": 0.011809266172349453,
      "rotation_flip": 0.006786562502384186,
      "sparse_tokens": 32089.0,
      "step": 4016,
      "turn_loss": 0.09681116044521332,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.18662887939044787,
      "grad_norm": 0.7680022120475769,
      "learning_rate": 7.572923288481355e-06,
      "loss": 0.1086,
      "mae_dtheta": 0.014210839755833149,
      "mae_dx": 0.0031335982494056225,
      "mae_dy": 0.004155097994953394,
      "pose_mae_dtheta": 0.10690934956073761,
      "pose_mae_dx": 0.0354585275053978,
      "pose_mae_dy": 0.03421933948993683,
      "pose_rmse_dtheta": 0.2693847715854645,
      "pose_rmse_dx": 0.0837513729929924,
      "pose_rmse_dy": 0.07933517545461655,
      "pose_rmse_mean": 0.14415711164474487,
      "rmse_dtheta": 0.031200898811221123,
      "rmse_dx": 0.007978188805282116,
      "rmse_dy": 0.00987135712057352,
      "rmse_mean": 0.016350148245692253,
      "rotation_flip": 0.00806734524667263,
      "sparse_tokens": 32153.0,
      "step": 4017,
      "turn_loss": 0.12723086774349213,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.18667533915629064,
      "grad_norm": 0.5894180536270142,
      "learning_rate": 7.571789475518399e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.01601567678153515,
      "mae_dx": 0.004248128738254309,
      "mae_dy": 0.003041026648133993,
      "pose_mae_dtheta": 0.13516423106193542,
      "pose_mae_dx": 0.04265633970499039,
      "pose_mae_dy": 0.061682771891355515,
      "pose_rmse_dtheta": 0.2437554895877838,
      "pose_rmse_dx": 0.13643793761730194,
      "pose_rmse_dy": 0.13286693394184113,
      "pose_rmse_mean": 0.17102012038230896,
      "rmse_dtheta": 0.028587976470589638,
      "rmse_dx": 0.014390315860509872,
      "rmse_dy": 0.005413760431110859,
      "rmse_mean": 0.016130685806274414,
      "rotation_flip": 0.004999999888241291,
      "sparse_tokens": 9960.0,
      "step": 4018,
      "turn_loss": 0.1248682364821434,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.18672179892213342,
      "grad_norm": 0.5145079493522644,
      "learning_rate": 7.570655482708822e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.008750537410378456,
      "mae_dx": 0.0013478855835273862,
      "mae_dy": 0.001271560788154602,
      "pose_mae_dtheta": 0.06307695806026459,
      "pose_mae_dx": 0.016812065616250038,
      "pose_mae_dy": 0.02033134363591671,
      "pose_rmse_dtheta": 0.2002711296081543,
      "pose_rmse_dx": 0.04558165371417999,
      "pose_rmse_dy": 0.06485491991043091,
      "pose_rmse_mean": 0.10356923192739487,
      "rmse_dtheta": 0.023985104635357857,
      "rmse_dx": 0.004178833216428757,
      "rmse_dy": 0.0034084783401340246,
      "rmse_mean": 0.010524138808250427,
      "rotation_flip": 0.0034246575087308884,
      "sparse_tokens": 32121.0,
      "step": 4019,
      "turn_loss": 0.05363757163286209,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.18676825868797622,
      "grad_norm": 0.5849232077598572,
      "learning_rate": 7.56952131013193e-06,
      "loss": 0.1206,
      "mae_dtheta": 0.027534596621990204,
      "mae_dx": 0.007013646885752678,
      "mae_dy": 0.00414276635274291,
      "pose_mae_dtheta": 0.18348906934261322,
      "pose_mae_dx": 0.053427860140800476,
      "pose_mae_dy": 0.05257792770862579,
      "pose_rmse_dtheta": 0.34263846278190613,
      "pose_rmse_dx": 0.1302012950181961,
      "pose_rmse_dy": 0.10346154123544693,
      "pose_rmse_mean": 0.19210045039653778,
      "rmse_dtheta": 0.04491510987281799,
      "rmse_dx": 0.01687556877732277,
      "rmse_dy": 0.006994255352765322,
      "rmse_mean": 0.022928312420845032,
      "rotation_flip": 0.012027491815388203,
      "sparse_tokens": 9685.0,
      "step": 4020,
      "turn_loss": 0.18042905628681183,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.186814718453819,
      "grad_norm": 0.8939192891120911,
      "learning_rate": 7.568386957867033e-06,
      "loss": 0.2589,
      "mae_dtheta": 0.05506275221705437,
      "mae_dx": 0.011934532783925533,
      "mae_dy": 0.005351570434868336,
      "pose_mae_dtheta": 0.4805212914943695,
      "pose_mae_dx": 0.09825477749109268,
      "pose_mae_dy": 0.07723294198513031,
      "pose_rmse_dtheta": 0.7340152859687805,
      "pose_rmse_dx": 0.19469885528087616,
      "pose_rmse_dy": 0.18581314384937286,
      "pose_rmse_mean": 0.3715091347694397,
      "rmse_dtheta": 0.07481211423873901,
      "rmse_dx": 0.02329108491539955,
      "rmse_dy": 0.01092794630676508,
      "rmse_mean": 0.03634371608495712,
      "rotation_flip": 0.02074074000120163,
      "sparse_tokens": 11136.0,
      "step": 4021,
      "turn_loss": 0.3265354335308075,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.18686117821966178,
      "grad_norm": 0.558594286441803,
      "learning_rate": 7.567252425993456e-06,
      "loss": 0.1031,
      "mae_dtheta": 0.006335470359772444,
      "mae_dx": 0.0010881053749471903,
      "mae_dy": 0.0012034059036523104,
      "pose_mae_dtheta": 0.0454334132373333,
      "pose_mae_dx": 0.015328184701502323,
      "pose_mae_dy": 0.019458580762147903,
      "pose_rmse_dtheta": 0.11243218928575516,
      "pose_rmse_dx": 0.03723929822444916,
      "pose_rmse_dy": 0.044509295374155045,
      "pose_rmse_mean": 0.06472693383693695,
      "rmse_dtheta": 0.014890084974467754,
      "rmse_dx": 0.003212591866031289,
      "rmse_dy": 0.0024993671104311943,
      "rmse_mean": 0.006867348216474056,
      "rotation_flip": 0.0011890606256201863,
      "sparse_tokens": 32137.0,
      "step": 4022,
      "turn_loss": 0.046369656920433044,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.18690763798550455,
      "grad_norm": 0.7745739221572876,
      "learning_rate": 7.566117714590542e-06,
      "loss": 0.0838,
      "mae_dtheta": 0.008696494624018669,
      "mae_dx": 0.0023075242061167955,
      "mae_dy": 0.0018055950058624148,
      "pose_mae_dtheta": 0.060427844524383545,
      "pose_mae_dx": 0.025721026584506035,
      "pose_mae_dy": 0.02002478577196598,
      "pose_rmse_dtheta": 0.170284703373909,
      "pose_rmse_dx": 0.059887949377298355,
      "pose_rmse_dy": 0.04930007457733154,
      "pose_rmse_mean": 0.0931575745344162,
      "rmse_dtheta": 0.0225477647036314,
      "rmse_dx": 0.006363744381815195,
      "rmse_dy": 0.004560086410492659,
      "rmse_mean": 0.011157198809087276,
      "rotation_flip": 0.0021758051589131355,
      "sparse_tokens": 32185.0,
      "step": 4023,
      "turn_loss": 0.07477748394012451,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.18695409775134733,
      "grad_norm": 0.46639516949653625,
      "learning_rate": 7.5649828237376366e-06,
      "loss": 0.1085,
      "mae_dtheta": 0.014214900322258472,
      "mae_dx": 0.002753703622147441,
      "mae_dy": 0.004119051154702902,
      "pose_mae_dtheta": 0.0916275605559349,
      "pose_mae_dx": 0.042186468839645386,
      "pose_mae_dy": 0.04429871216416359,
      "pose_rmse_dtheta": 0.17005103826522827,
      "pose_rmse_dx": 0.09568218886852264,
      "pose_rmse_dy": 0.08287353813648224,
      "pose_rmse_mean": 0.11620225757360458,
      "rmse_dtheta": 0.024899661540985107,
      "rmse_dx": 0.007800971157848835,
      "rmse_dy": 0.008117911405861378,
      "rmse_mean": 0.013606181368231773,
      "rotation_flip": 0.005282271187752485,
      "sparse_tokens": 32073.0,
      "step": 4024,
      "turn_loss": 0.12419474869966507,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.1870005575171901,
      "grad_norm": 0.49425941705703735,
      "learning_rate": 7.563847753514106e-06,
      "loss": 0.1887,
      "mae_dtheta": 0.03691575676202774,
      "mae_dx": 0.012374583631753922,
      "mae_dy": 0.006274270825088024,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.49425944685935974,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 146.27459716796875,
      "model/head/act_norm_mean": 110.43133544921875,
      "model/head/act_norm_min": 73.2020034790039,
      "model/head/act_over_embed": 75.88944759515456,
      "model/head/grad_frac": 0.12570437788963318,
      "model/head/grad_norm": 0.062130577862262726,
      "model/head/grad_zero_frac": 0.0001856039889389649,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.68817138671875,
      "model/head/update_ratio": 0.0010676512029021978,
      "model/head/weight_delta": 7.486757278442383,
      "model/head/weight_delta_rel": 0.131339892745018,
      "model/head/weight_norm": 58.19370651245117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41762593388557434,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41762593388557434,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41762593388557434,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2869964516417608,
      "model/modality_embedder.encoders.pose/grad_frac": 0.046802155673503876,
      "model/modality_embedder.encoders.pose/grad_norm": 0.023132408037781715,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.54296875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0007492200820706785,
      "model/modality_embedder.encoders.pose/weight_delta": 2.4633665084838867,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08048585802316666,
      "model/modality_embedder.encoders.pose/weight_norm": 30.87531852722168,
      "model/modality_embedder/grad_frac": 0.046802155673503876,
      "model/modality_embedder/grad_norm": 0.023132408037781715,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.54296875,
      "model/modality_embedder/update_ratio": 0.0007492200820706785,
      "model/modality_embedder/weight_delta": 2.4633665084838867,
      "model/modality_embedder/weight_delta_rel": 0.08048585802316666,
      "model/modality_embedder/weight_norm": 30.87531852722168,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.8902587890625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.588116939484127,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.990104675292969,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.2099747962436,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11716462671756744,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05790972337126732,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020868785213679075,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.7567788362503052,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06401807814836502,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.74944496154785,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.22563171386719,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.437081473214285,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.792128562927246,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.793391171954152,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10699937492609024,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.052885450422763824,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001797654782421887,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.219932794570923,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07690020650625229,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.41913604736328,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.62603759765625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.091834077380952,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.293676376342773,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.930552653575447,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09888258576393127,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0488736517727375,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016091910656541586,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.382427215576172,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.07999744266271591,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.371564865112305,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.14149475097656,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.02755146329365,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.269111633300781,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.260795763646346,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07793906331062317,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03852211683988571,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012977799633517861,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.033935546875,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06951026618480682,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.683088302612305,
      "model/normalizer/grad_frac": 0.33460888266563416,
      "model/normalizer/grad_norm": 0.16538360714912415,
      "model/normalizer/grad_zero_frac": 0.0001654433726798743,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021131341345608234,
      "model/normalizer/weight_delta": 4.320912837982178,
      "model/normalizer/weight_delta_rel": 0.05565085634589195,
      "model/normalizer/weight_norm": 78.26460266113281,
      "pose_mae_dtheta": 0.3028568923473358,
      "pose_mae_dx": 0.10851836204528809,
      "pose_mae_dy": 0.06485868990421295,
      "pose_rmse_dtheta": 0.5295179486274719,
      "pose_rmse_dx": 0.24545465409755707,
      "pose_rmse_dy": 0.15232913196086884,
      "pose_rmse_mean": 0.30910059809684753,
      "rmse_dtheta": 0.054724473506212234,
      "rmse_dx": 0.025193968787789345,
      "rmse_dy": 0.013199498876929283,
      "rmse_mean": 0.031039316207170486,
      "rotation_flip": 0.009771986864507198,
      "sparse_tokens": 21104.0,
      "step": 4025,
      "turn_loss": 0.32482242584228516,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.18704701728303288,
      "grad_norm": 0.5780164003372192,
      "learning_rate": 7.562712503999327e-06,
      "loss": 0.0846,
      "mae_dtheta": 0.007845988497138023,
      "mae_dx": 0.0016608850564807653,
      "mae_dy": 0.00035221874713897705,
      "pose_mae_dtheta": 0.055395759642124176,
      "pose_mae_dx": 0.014154219068586826,
      "pose_mae_dy": 0.005549239460378885,
      "pose_rmse_dtheta": 0.23820441961288452,
      "pose_rmse_dx": 0.03442975878715515,
      "pose_rmse_dy": 0.013284662738442421,
      "pose_rmse_mean": 0.09530627727508545,
      "rmse_dtheta": 0.028880873695015907,
      "rmse_dx": 0.005035471171140671,
      "rmse_dy": 0.0006545971264131367,
      "rmse_mean": 0.011523648165166378,
      "rotation_flip": 0.0,
      "sparse_tokens": 32185.0,
      "step": 4026,
      "turn_loss": 0.04665929451584816,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.18709347704887566,
      "grad_norm": 1.5119296312332153,
      "learning_rate": 7.561577075272686e-06,
      "loss": 0.3861,
      "mae_dtheta": 0.04432835802435875,
      "mae_dx": 0.018432114273309708,
      "mae_dy": 0.008347171358764172,
      "pose_mae_dtheta": 0.3823590874671936,
      "pose_mae_dx": 0.14790120720863342,
      "pose_mae_dy": 0.09125488251447678,
      "pose_rmse_dtheta": 0.6016983985900879,
      "pose_rmse_dx": 0.2988263666629791,
      "pose_rmse_dy": 0.1877916008234024,
      "pose_rmse_mean": 0.3627721071243286,
      "rmse_dtheta": 0.06318449974060059,
      "rmse_dx": 0.031153971329331398,
      "rmse_dy": 0.016994185745716095,
      "rmse_mean": 0.037110887467861176,
      "rotation_flip": 0.019966721534729004,
      "sparse_tokens": 9804.0,
      "step": 4027,
      "turn_loss": 0.42591485381126404,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18713993681471847,
      "grad_norm": 0.9417344331741333,
      "learning_rate": 7.560441467413586e-06,
      "loss": 0.0816,
      "mae_dtheta": 0.007878756150603294,
      "mae_dx": 0.0014959917170926929,
      "mae_dy": 0.0015175648732110858,
      "pose_mae_dtheta": 0.05111785605549812,
      "pose_mae_dx": 0.017052320763468742,
      "pose_mae_dy": 0.021200057119131088,
      "pose_rmse_dtheta": 0.10906755924224854,
      "pose_rmse_dx": 0.040956802666187286,
      "pose_rmse_dy": 0.05304904654622078,
      "pose_rmse_mean": 0.0676911324262619,
      "rmse_dtheta": 0.017436182126402855,
      "rmse_dx": 0.004632618278264999,
      "rmse_dy": 0.003185996552929282,
      "rmse_mean": 0.008418265730142593,
      "rotation_flip": 0.0016792610986158252,
      "sparse_tokens": 32089.0,
      "step": 4028,
      "turn_loss": 0.0678136870265007,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.18718639658056124,
      "grad_norm": 0.8244628310203552,
      "learning_rate": 7.5593056805014385e-06,
      "loss": 0.143,
      "mae_dtheta": 0.010100100189447403,
      "mae_dx": 0.001959640998393297,
      "mae_dy": 0.0024762519169598818,
      "pose_mae_dtheta": 0.0686965137720108,
      "pose_mae_dx": 0.025815915316343307,
      "pose_mae_dy": 0.03158322349190712,
      "pose_rmse_dtheta": 0.14522457122802734,
      "pose_rmse_dx": 0.0677781030535698,
      "pose_rmse_dy": 0.0723506361246109,
      "pose_rmse_mean": 0.09511777013540268,
      "rmse_dtheta": 0.020315872505307198,
      "rmse_dx": 0.0068000988103449345,
      "rmse_dy": 0.005295862909406424,
      "rmse_mean": 0.010803944431245327,
      "rotation_flip": 0.0035294117406010628,
      "sparse_tokens": 32073.0,
      "step": 4029,
      "turn_loss": 0.09025051444768906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.18723285634640402,
      "grad_norm": 0.4580380320549011,
      "learning_rate": 7.558169714615673e-06,
      "loss": 0.122,
      "mae_dtheta": 0.010005423799157143,
      "mae_dx": 0.0018741147359833121,
      "mae_dy": 0.002227374352514744,
      "pose_mae_dtheta": 0.0678701102733612,
      "pose_mae_dx": 0.023432867601513863,
      "pose_mae_dy": 0.02553214505314827,
      "pose_rmse_dtheta": 0.15730029344558716,
      "pose_rmse_dx": 0.06691357493400574,
      "pose_rmse_dy": 0.058895424008369446,
      "pose_rmse_mean": 0.09436976909637451,
      "rmse_dtheta": 0.021957915276288986,
      "rmse_dx": 0.006151133682578802,
      "rmse_dy": 0.004866465460509062,
      "rmse_mean": 0.010991837829351425,
      "rotation_flip": 0.004085338208824396,
      "sparse_tokens": 32073.0,
      "step": 4030,
      "turn_loss": 0.08862341195344925,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.1872793161122468,
      "grad_norm": 0.6596150994300842,
      "learning_rate": 7.557033569835726e-06,
      "loss": 0.2585,
      "mae_dtheta": 0.030735692009329796,
      "mae_dx": 0.011117697693407536,
      "mae_dy": 0.005910070613026619,
      "pose_mae_dtheta": 0.23264874517917633,
      "pose_mae_dx": 0.09174894541501999,
      "pose_mae_dy": 0.060692012310028076,
      "pose_rmse_dtheta": 0.40161535143852234,
      "pose_rmse_dx": 0.20732218027114868,
      "pose_rmse_dy": 0.12027285993099213,
      "pose_rmse_mean": 0.24307012557983398,
      "rmse_dtheta": 0.04568849131464958,
      "rmse_dx": 0.023269087076187134,
      "rmse_dy": 0.011098897084593773,
      "rmse_mean": 0.026685494929552078,
      "rotation_flip": 0.022528160363435745,
      "sparse_tokens": 14011.0,
      "step": 4031,
      "turn_loss": 0.2869180738925934,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.18732577587808957,
      "grad_norm": 0.6554621458053589,
      "learning_rate": 7.555897246241047e-06,
      "loss": 0.1216,
      "mae_dtheta": 0.02623710036277771,
      "mae_dx": 0.009354248642921448,
      "mae_dy": 0.0036685282830148935,
      "pose_mae_dtheta": 0.19336989521980286,
      "pose_mae_dx": 0.07891225069761276,
      "pose_mae_dy": 0.04189619421958923,
      "pose_rmse_dtheta": 0.34232279658317566,
      "pose_rmse_dx": 0.17017453908920288,
      "pose_rmse_dy": 0.08327777683734894,
      "pose_rmse_mean": 0.1985916942358017,
      "rmse_dtheta": 0.03830248862504959,
      "rmse_dx": 0.019964471459388733,
      "rmse_dy": 0.0061455294489860535,
      "rmse_mean": 0.021470829844474792,
      "rotation_flip": 0.008797653950750828,
      "sparse_tokens": 5838.0,
      "step": 4032,
      "turn_loss": 0.2179345190525055,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.18737223564393235,
      "grad_norm": 0.6403189897537231,
      "learning_rate": 7.554760743911104e-06,
      "loss": 0.2247,
      "mae_dtheta": 0.03774048760533333,
      "mae_dx": 0.012014277279376984,
      "mae_dy": 0.005492223892360926,
      "pose_mae_dtheta": 0.2656577229499817,
      "pose_mae_dx": 0.10642214864492416,
      "pose_mae_dy": 0.06734587997198105,
      "pose_rmse_dtheta": 0.49010545015335083,
      "pose_rmse_dx": 0.2294142097234726,
      "pose_rmse_dy": 0.12007149308919907,
      "pose_rmse_mean": 0.27986371517181396,
      "rmse_dtheta": 0.05406886339187622,
      "rmse_dx": 0.024452541023492813,
      "rmse_dy": 0.00924784317612648,
      "rmse_mean": 0.029256414622068405,
      "rotation_flip": 0.012077294290065765,
      "sparse_tokens": 7022.0,
      "step": 4033,
      "turn_loss": 0.2652069926261902,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 23941.0,
      "epoch": 0.18741869540977513,
      "grad_norm": 0.5148643851280212,
      "learning_rate": 7.55362406292537e-06,
      "loss": 0.1478,
      "mae_dtheta": 0.037632107734680176,
      "mae_dx": 0.011488349176943302,
      "mae_dy": 0.0037367769982665777,
      "pose_mae_dtheta": 0.31154051423072815,
      "pose_mae_dx": 0.0873662680387497,
      "pose_mae_dy": 0.05072478950023651,
      "pose_rmse_dtheta": 0.5983337163925171,
      "pose_rmse_dx": 0.22322872281074524,
      "pose_rmse_dy": 0.13584548234939575,
      "pose_rmse_mean": 0.31913596391677856,
      "rmse_dtheta": 0.06002960354089737,
      "rmse_dx": 0.02476203814148903,
      "rmse_dy": 0.007475090678781271,
      "rmse_mean": 0.030755579471588135,
      "rotation_flip": 0.008556149899959564,
      "sparse_tokens": 18843.0,
      "step": 4034,
      "turn_loss": 0.2247445434331894,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.1874651551756179,
      "grad_norm": 0.5668095946311951,
      "learning_rate": 7.552487203363334e-06,
      "loss": 0.1204,
      "mae_dtheta": 0.033855438232421875,
      "mae_dx": 0.019938740879297256,
      "mae_dy": 0.00950203463435173,
      "pose_mae_dtheta": 0.2309664934873581,
      "pose_mae_dx": 0.15361149609088898,
      "pose_mae_dy": 0.12356193363666534,
      "pose_rmse_dtheta": 0.3498959541320801,
      "pose_rmse_dx": 0.28446531295776367,
      "pose_rmse_dy": 0.23948904871940613,
      "pose_rmse_mean": 0.2912834584712982,
      "rmse_dtheta": 0.049178048968315125,
      "rmse_dx": 0.03329695016145706,
      "rmse_dy": 0.01685195043683052,
      "rmse_mean": 0.03310898691415787,
      "rotation_flip": 0.01315789483487606,
      "sparse_tokens": 6947.0,
      "step": 4035,
      "turn_loss": 0.3697362244129181,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 30401.0,
      "epoch": 0.1875116149414607,
      "grad_norm": 0.4988558292388916,
      "learning_rate": 7.5513501653045e-06,
      "loss": 0.1578,
      "mae_dtheta": 0.03598446026444435,
      "mae_dx": 0.009449836798012257,
      "mae_dy": 0.003854854963719845,
      "pose_mae_dtheta": 0.2869061827659607,
      "pose_mae_dx": 0.07597337663173676,
      "pose_mae_dy": 0.048769261687994,
      "pose_rmse_dtheta": 0.5403932332992554,
      "pose_rmse_dx": 0.18962198495864868,
      "pose_rmse_dy": 0.1148778423666954,
      "pose_rmse_mean": 0.2816310226917267,
      "rmse_dtheta": 0.05587651953101158,
      "rmse_dx": 0.02176845632493496,
      "rmse_dy": 0.008842051960527897,
      "rmse_mean": 0.02882900834083557,
      "rotation_flip": 0.011180992238223553,
      "sparse_tokens": 24036.0,
      "step": 4036,
      "turn_loss": 0.25357353687286377,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.18755807470730348,
      "grad_norm": 0.5674185752868652,
      "learning_rate": 7.550212948828377e-06,
      "loss": 0.1895,
      "mae_dtheta": 0.03633915260434151,
      "mae_dx": 0.01163746602833271,
      "mae_dy": 0.008187351748347282,
      "pose_mae_dtheta": 0.3060884177684784,
      "pose_mae_dx": 0.10408827662467957,
      "pose_mae_dy": 0.10048958659172058,
      "pose_rmse_dtheta": 0.5043782591819763,
      "pose_rmse_dx": 0.21142911911010742,
      "pose_rmse_dy": 0.22009065747261047,
      "pose_rmse_mean": 0.31196603178977966,
      "rmse_dtheta": 0.05190960317850113,
      "rmse_dx": 0.023137014359235764,
      "rmse_dy": 0.016798345372080803,
      "rmse_mean": 0.030614987015724182,
      "rotation_flip": 0.016460904851555824,
      "sparse_tokens": 20651.0,
      "step": 4037,
      "turn_loss": 0.3147662281990051,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.18760453447314626,
      "grad_norm": 0.5956995487213135,
      "learning_rate": 7.549075554014495e-06,
      "loss": 0.1834,
      "mae_dtheta": 0.039680007845163345,
      "mae_dx": 0.011136951856315136,
      "mae_dy": 0.0037934661377221346,
      "pose_mae_dtheta": 0.3529892563819885,
      "pose_mae_dx": 0.07690810412168503,
      "pose_mae_dy": 0.06706760823726654,
      "pose_rmse_dtheta": 0.5949472188949585,
      "pose_rmse_dx": 0.17191098630428314,
      "pose_rmse_dy": 0.1826949268579483,
      "pose_rmse_mean": 0.31651771068573,
      "rmse_dtheta": 0.05836504325270653,
      "rmse_dx": 0.02353093959391117,
      "rmse_dy": 0.00781044689938426,
      "rmse_mean": 0.02990214340388775,
      "rotation_flip": 0.012698412872850895,
      "sparse_tokens": 5550.0,
      "step": 4038,
      "turn_loss": 0.19636258482933044,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.18765099423898904,
      "grad_norm": 0.4291257858276367,
      "learning_rate": 7.5479379809423905e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.025900449603796005,
      "mae_dx": 0.008618579246103764,
      "mae_dy": 0.0022675320506095886,
      "pose_mae_dtheta": 0.20158275961875916,
      "pose_mae_dx": 0.06565617024898529,
      "pose_mae_dy": 0.022351304069161415,
      "pose_rmse_dtheta": 0.43653571605682373,
      "pose_rmse_dx": 0.19229206442832947,
      "pose_rmse_dy": 0.053482599556446075,
      "pose_rmse_mean": 0.22743681073188782,
      "rmse_dtheta": 0.046576324850320816,
      "rmse_dx": 0.021657664328813553,
      "rmse_dy": 0.005020938813686371,
      "rmse_mean": 0.024418309330940247,
      "rotation_flip": 0.007984031923115253,
      "sparse_tokens": 10050.0,
      "step": 4039,
      "turn_loss": 0.1621270626783371,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.18769745400483182,
      "grad_norm": 0.5155790448188782,
      "learning_rate": 7.546800229691616e-06,
      "loss": 0.1233,
      "mae_dtheta": 0.022300321608781815,
      "mae_dx": 0.01004871167242527,
      "mae_dy": 0.0032996749505400658,
      "pose_mae_dtheta": 0.16406063735485077,
      "pose_mae_dx": 0.09213384985923767,
      "pose_mae_dy": 0.03300320729613304,
      "pose_rmse_dtheta": 0.3183092474937439,
      "pose_rmse_dx": 0.226926788687706,
      "pose_rmse_dy": 0.08345624804496765,
      "pose_rmse_mean": 0.20956408977508545,
      "rmse_dtheta": 0.03906587138772011,
      "rmse_dx": 0.022565649822354317,
      "rmse_dy": 0.008288232609629631,
      "rmse_mean": 0.02330658584833145,
      "rotation_flip": 0.010496183298528194,
      "sparse_tokens": 22688.0,
      "step": 4040,
      "turn_loss": 0.17121241986751556,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.1877439137706746,
      "grad_norm": 0.5731402635574341,
      "learning_rate": 7.545662300341736e-06,
      "loss": 0.1507,
      "mae_dtheta": 0.024696514010429382,
      "mae_dx": 0.010929676704108715,
      "mae_dy": 0.0046568214893341064,
      "pose_mae_dtheta": 0.19345276057720184,
      "pose_mae_dx": 0.08608727902173996,
      "pose_mae_dy": 0.06334562599658966,
      "pose_rmse_dtheta": 0.36619409918785095,
      "pose_rmse_dx": 0.19488152861595154,
      "pose_rmse_dy": 0.13838514685630798,
      "pose_rmse_mean": 0.2331535816192627,
      "rmse_dtheta": 0.04178375005722046,
      "rmse_dx": 0.023644521832466125,
      "rmse_dy": 0.008783533237874508,
      "rmse_mean": 0.024737268686294556,
      "rotation_flip": 0.008943089284002781,
      "sparse_tokens": 22935.0,
      "step": 4041,
      "turn_loss": 0.18945197761058807,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 11021.0,
      "epoch": 0.18779037353651737,
      "grad_norm": 0.4889867305755615,
      "learning_rate": 7.544524192972323e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.033167336136102676,
      "mae_dx": 0.007844551466405392,
      "mae_dy": 0.002982754958793521,
      "pose_mae_dtheta": 0.2807842195034027,
      "pose_mae_dx": 0.05648912116885185,
      "pose_mae_dy": 0.04137275367975235,
      "pose_rmse_dtheta": 0.5608532428741455,
      "pose_rmse_dx": 0.16313783824443817,
      "pose_rmse_dy": 0.08601667732000351,
      "pose_rmse_mean": 0.2700026035308838,
      "rmse_dtheta": 0.05551688373088837,
      "rmse_dx": 0.020538408309221268,
      "rmse_dy": 0.0059638861566782,
      "rmse_mean": 0.027339724823832512,
      "rotation_flip": 0.011111111380159855,
      "sparse_tokens": 9412.0,
      "step": 4042,
      "turn_loss": 0.17681632936000824,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.18783683330236015,
      "grad_norm": 0.5420631170272827,
      "learning_rate": 7.543385907662968e-06,
      "loss": 0.1141,
      "mae_dtheta": 0.039427466690540314,
      "mae_dx": 0.01354287564754486,
      "mae_dy": 0.0029102989938110113,
      "pose_mae_dtheta": 0.3147599697113037,
      "pose_mae_dx": 0.11940000206232071,
      "pose_mae_dy": 0.03678418695926666,
      "pose_rmse_dtheta": 0.5630107522010803,
      "pose_rmse_dx": 0.26046648621559143,
      "pose_rmse_dy": 0.0857912078499794,
      "pose_rmse_mean": 0.3030894994735718,
      "rmse_dtheta": 0.059886634349823,
      "rmse_dx": 0.02656080387532711,
      "rmse_dy": 0.005959426052868366,
      "rmse_mean": 0.03080229088664055,
      "rotation_flip": 0.015665795654058456,
      "sparse_tokens": 6011.0,
      "step": 4043,
      "turn_loss": 0.21979309618473053,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.18788329306820295,
      "grad_norm": 0.48846229910850525,
      "learning_rate": 7.5422474444932715e-06,
      "loss": 0.1803,
      "mae_dtheta": 0.04168093204498291,
      "mae_dx": 0.012376731261610985,
      "mae_dy": 0.005665904376655817,
      "pose_mae_dtheta": 0.33125758171081543,
      "pose_mae_dx": 0.08919770270586014,
      "pose_mae_dy": 0.0689658597111702,
      "pose_rmse_dtheta": 0.5372236967086792,
      "pose_rmse_dx": 0.19842348992824554,
      "pose_rmse_dy": 0.15330444276332855,
      "pose_rmse_mean": 0.2963172197341919,
      "rmse_dtheta": 0.058062441647052765,
      "rmse_dx": 0.02452673949301243,
      "rmse_dy": 0.011491398327052593,
      "rmse_mean": 0.0313601940870285,
      "rotation_flip": 0.013837638311088085,
      "sparse_tokens": 15385.0,
      "step": 4044,
      "turn_loss": 0.3420041501522064,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.18792975283404573,
      "grad_norm": 0.5579213500022888,
      "learning_rate": 7.541108803542846e-06,
      "loss": 0.1585,
      "mae_dtheta": 0.010247576050460339,
      "mae_dx": 0.002123903250321746,
      "mae_dy": 0.00238050171174109,
      "pose_mae_dtheta": 0.07536953687667847,
      "pose_mae_dx": 0.021441804245114326,
      "pose_mae_dy": 0.027875224128365517,
      "pose_rmse_dtheta": 0.2256963551044464,
      "pose_rmse_dx": 0.059472110122442245,
      "pose_rmse_dy": 0.08517429232597351,
      "pose_rmse_mean": 0.12344758957624435,
      "rmse_dtheta": 0.026482194662094116,
      "rmse_dx": 0.008540330454707146,
      "rmse_dy": 0.006964986212551594,
      "rmse_mean": 0.013995837420225143,
      "rotation_flip": 0.006808897014707327,
      "sparse_tokens": 32073.0,
      "step": 4045,
      "turn_loss": 0.08493831753730774,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1879762125998885,
      "grad_norm": 0.6235859990119934,
      "learning_rate": 7.5399699848913186e-06,
      "loss": 0.1538,
      "mae_dtheta": 0.014636391773819923,
      "mae_dx": 0.002679639495909214,
      "mae_dy": 0.004232080187648535,
      "pose_mae_dtheta": 0.08939617872238159,
      "pose_mae_dx": 0.03731800243258476,
      "pose_mae_dy": 0.042188290506601334,
      "pose_rmse_dtheta": 0.1733335554599762,
      "pose_rmse_dx": 0.08976279199123383,
      "pose_rmse_dy": 0.09620383381843567,
      "pose_rmse_mean": 0.1197667270898819,
      "rmse_dtheta": 0.02599673718214035,
      "rmse_dx": 0.0072246273048222065,
      "rmse_dy": 0.00963126216083765,
      "rmse_mean": 0.014284208416938782,
      "rotation_flip": 0.007306226063519716,
      "sparse_tokens": 32121.0,
      "step": 4046,
      "turn_loss": 0.13652044534683228,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13607.0,
      "epoch": 0.18802267236573128,
      "grad_norm": 0.5342696309089661,
      "learning_rate": 7.538830988618326e-06,
      "loss": 0.1545,
      "mae_dtheta": 0.0320897102355957,
      "mae_dx": 0.012298965826630592,
      "mae_dy": 0.003910230007022619,
      "pose_mae_dtheta": 0.2564961016178131,
      "pose_mae_dx": 0.08652149885892868,
      "pose_mae_dy": 0.04840582609176636,
      "pose_rmse_dtheta": 0.4183299243450165,
      "pose_rmse_dx": 0.1898382008075714,
      "pose_rmse_dy": 0.1381184458732605,
      "pose_rmse_mean": 0.24876219034194946,
      "rmse_dtheta": 0.04631270095705986,
      "rmse_dx": 0.024718360975384712,
      "rmse_dy": 0.008982568979263306,
      "rmse_mean": 0.026671212166547775,
      "rotation_flip": 0.009630818851292133,
      "sparse_tokens": 11380.0,
      "step": 4047,
      "turn_loss": 0.2367236465215683,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.18806913213157406,
      "grad_norm": 0.8703166842460632,
      "learning_rate": 7.537691814803522e-06,
      "loss": 0.3342,
      "mae_dtheta": 0.04912625998258591,
      "mae_dx": 0.02232007309794426,
      "mae_dy": 0.012855942361056805,
      "pose_mae_dtheta": 0.40101367235183716,
      "pose_mae_dx": 0.1827792525291443,
      "pose_mae_dy": 0.11642151325941086,
      "pose_rmse_dtheta": 0.6325387358665466,
      "pose_rmse_dx": 0.32361486554145813,
      "pose_rmse_dy": 0.22358104586601257,
      "pose_rmse_mean": 0.3932449221611023,
      "rmse_dtheta": 0.0670003890991211,
      "rmse_dx": 0.033907417207956314,
      "rmse_dy": 0.024397296831011772,
      "rmse_mean": 0.04176836833357811,
      "rotation_flip": 0.01075268816202879,
      "sparse_tokens": 6733.0,
      "step": 4048,
      "turn_loss": 0.6344382762908936,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.18811559189741683,
      "grad_norm": 0.6610572934150696,
      "learning_rate": 7.536552463526565e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.03995227813720703,
      "mae_dx": 0.011572553776204586,
      "mae_dy": 0.004498164635151625,
      "pose_mae_dtheta": 0.336771696805954,
      "pose_mae_dx": 0.08626715838909149,
      "pose_mae_dy": 0.05845731124281883,
      "pose_rmse_dtheta": 0.5762120485305786,
      "pose_rmse_dx": 0.20768238604068756,
      "pose_rmse_dy": 0.1364259272813797,
      "pose_rmse_mean": 0.30677345395088196,
      "rmse_dtheta": 0.05761964991688728,
      "rmse_dx": 0.02517131343483925,
      "rmse_dy": 0.007599209900945425,
      "rmse_mean": 0.030130058526992798,
      "rotation_flip": 0.013605441898107529,
      "sparse_tokens": 10031.0,
      "step": 4049,
      "turn_loss": 0.3158665895462036,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1881620516632596,
      "grad_norm": 0.7239668369293213,
      "learning_rate": 7.535412934867134e-06,
      "loss": 0.1538,
      "mae_dtheta": 0.01501787081360817,
      "mae_dx": 0.001808009808883071,
      "mae_dy": 0.0034787957556545734,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7239669561386108,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.844970703125,
      "model/head/act_norm_mean": 104.57406092171718,
      "model/head/act_norm_min": 66.25174713134766,
      "model/head/act_over_embed": 71.86427370318738,
      "model/head/grad_frac": 0.09401294589042664,
      "model/head/grad_norm": 0.06806226819753647,
      "model/head/grad_zero_frac": 0.0001754512923071161,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7005454940025253,
      "model/head/update_ratio": 0.001169467344880104,
      "model/head/weight_delta": 7.511209011077881,
      "model/head/weight_delta_rel": 0.1317688524723053,
      "model/head/weight_norm": 58.19937515258789,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41774728894233704,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41768477479433685,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4176190197467804,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2870368876651397,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05008545517921448,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0362602137029171,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5386844758064516,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011743867071345448,
      "model/modality_embedder.encoders.pose/weight_delta": 2.4688363075256348,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08066457509994507,
      "model/modality_embedder.encoders.pose/weight_norm": 30.875873565673828,
      "model/modality_embedder/grad_frac": 0.05008545517921448,
      "model/modality_embedder/grad_norm": 0.0362602137029171,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5386844758064516,
      "model/modality_embedder/update_ratio": 0.0011743867071345448,
      "model/modality_embedder/weight_delta": 2.4688363075256348,
      "model/modality_embedder/weight_delta_rel": 0.08066457509994507,
      "model/modality_embedder/weight_norm": 30.875873565673828,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.64883422851562,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.95334545855379,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.960770606994629,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.773753891724036,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07034019380807877,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05092397332191467,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018349771853536367,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.765918493270874,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06435113400220871,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.751829147338867,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.17443084716797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.92509169071669,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.522269248962402,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.44154700009794,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08121965825557709,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0588003508746624,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019984780810773373,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.230989456176758,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07728321850299835,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.422563552856445,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.10791015625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.812580166746834,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.856584548950195,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.73864675177138,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08697754889726639,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06296887248754501,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0020730316173285246,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.394157886505127,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08039133995771408,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.375259399414062,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.87388610839844,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.680432800224466,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.284585952758789,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.022252568609076,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10868953168392181,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0786876305937767,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 9.0784378699027e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0026507065631449223,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.043853521347046,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.06984921544790268,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.685531616210938,
      "model/normalizer/grad_frac": 0.4422627389431,
      "model/normalizer/grad_norm": 0.3201836049556732,
      "model/normalizer/grad_zero_frac": 0.00015835295198485255,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004090829286724329,
      "model/normalizer/weight_delta": 4.342339038848877,
      "model/normalizer/weight_delta_rel": 0.05592681095004082,
      "model/normalizer/weight_norm": 78.26863098144531,
      "pose_mae_dtheta": 0.1071065291762352,
      "pose_mae_dx": 0.029117433354258537,
      "pose_mae_dy": 0.04693128168582916,
      "pose_rmse_dtheta": 0.22925826907157898,
      "pose_rmse_dx": 0.0720234140753746,
      "pose_rmse_dy": 0.11186852306127548,
      "pose_rmse_mean": 0.13771674036979675,
      "rmse_dtheta": 0.028642717748880386,
      "rmse_dx": 0.005164426751434803,
      "rmse_dy": 0.0071274591609835625,
      "rmse_mean": 0.0136448685079813,
      "rotation_flip": 0.0062089115381240845,
      "sparse_tokens": 32057.0,
      "step": 4050,
      "turn_loss": 0.10729080438613892,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.1882085114291024,
      "grad_norm": 0.5515130162239075,
      "learning_rate": 7.534273228904916e-06,
      "loss": 0.0913,
      "mae_dtheta": 0.010655918158590794,
      "mae_dx": 0.0020576941315084696,
      "mae_dy": 0.0020325107034295797,
      "pose_mae_dtheta": 0.07038445770740509,
      "pose_mae_dx": 0.024920880794525146,
      "pose_mae_dy": 0.03169124573469162,
      "pose_rmse_dtheta": 0.1600421965122223,
      "pose_rmse_dx": 0.06900851428508759,
      "pose_rmse_dy": 0.08080615848302841,
      "pose_rmse_mean": 0.10328562557697296,
      "rmse_dtheta": 0.021865468472242355,
      "rmse_dx": 0.007446069736033678,
      "rmse_dy": 0.004427616484463215,
      "rmse_mean": 0.011246385052800179,
      "rotation_flip": 0.0027235588058829308,
      "sparse_tokens": 32041.0,
      "step": 4051,
      "turn_loss": 0.07817525416612625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31046.0,
      "epoch": 0.18825497119494516,
      "grad_norm": 0.5021049976348877,
      "learning_rate": 7.53313334571961e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.03855886682868004,
      "mae_dx": 0.012391450814902782,
      "mae_dy": 0.006576273124665022,
      "pose_mae_dtheta": 0.3031315505504608,
      "pose_mae_dx": 0.09600050747394562,
      "pose_mae_dy": 0.08438634872436523,
      "pose_rmse_dtheta": 0.5294134020805359,
      "pose_rmse_dx": 0.1960611492395401,
      "pose_rmse_dy": 0.17014044523239136,
      "pose_rmse_mean": 0.29853832721710205,
      "rmse_dtheta": 0.05587754026055336,
      "rmse_dx": 0.02458048239350319,
      "rmse_dy": 0.01104248408228159,
      "rmse_mean": 0.030500169843435287,
      "rotation_flip": 0.009459459222853184,
      "sparse_tokens": 24648.0,
      "step": 4052,
      "turn_loss": 0.3124731481075287,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.18830143096078797,
      "grad_norm": 0.39190492033958435,
      "learning_rate": 7.5319932853909296e-06,
      "loss": 0.1291,
      "mae_dtheta": 0.01533316820859909,
      "mae_dx": 0.003634404856711626,
      "mae_dy": 0.003587808459997177,
      "pose_mae_dtheta": 0.10934963077306747,
      "pose_mae_dx": 0.036999817937612534,
      "pose_mae_dy": 0.0355306975543499,
      "pose_rmse_dtheta": 0.26176661252975464,
      "pose_rmse_dx": 0.0939319059252739,
      "pose_rmse_dy": 0.08495081961154938,
      "pose_rmse_mean": 0.14688311517238617,
      "rmse_dtheta": 0.03220761567354202,
      "rmse_dx": 0.010384795255959034,
      "rmse_dy": 0.008632977493107319,
      "rmse_mean": 0.017075128853321075,
      "rotation_flip": 0.00773286446928978,
      "sparse_tokens": 32169.0,
      "step": 4053,
      "turn_loss": 0.1438777595758438,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.18834789072663075,
      "grad_norm": 0.6227233409881592,
      "learning_rate": 7.5308530479986e-06,
      "loss": 0.1638,
      "mae_dtheta": 0.0385434590280056,
      "mae_dx": 0.011325337924063206,
      "mae_dy": 0.005815042182803154,
      "pose_mae_dtheta": 0.2970743775367737,
      "pose_mae_dx": 0.10063835233449936,
      "pose_mae_dy": 0.053936392068862915,
      "pose_rmse_dtheta": 0.5058672428131104,
      "pose_rmse_dx": 0.20610785484313965,
      "pose_rmse_dy": 0.12505896389484406,
      "pose_rmse_mean": 0.2790113687515259,
      "rmse_dtheta": 0.05802164599299431,
      "rmse_dx": 0.022109998390078545,
      "rmse_dy": 0.01245526410639286,
      "rmse_mean": 0.03086230158805847,
      "rotation_flip": 0.016194332391023636,
      "sparse_tokens": 13231.0,
      "step": 4054,
      "turn_loss": 0.33285069465637207,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.18839435049247352,
      "grad_norm": 0.7937938570976257,
      "learning_rate": 7.529712633622358e-06,
      "loss": 0.1133,
      "mae_dtheta": 0.009270444512367249,
      "mae_dx": 0.001274034846574068,
      "mae_dy": 0.0013622764963656664,
      "pose_mae_dtheta": 0.060706451535224915,
      "pose_mae_dx": 0.012939023785293102,
      "pose_mae_dy": 0.017287809401750565,
      "pose_rmse_dtheta": 0.1868775337934494,
      "pose_rmse_dx": 0.0338391438126564,
      "pose_rmse_dy": 0.040092457085847855,
      "pose_rmse_mean": 0.08693638443946838,
      "rmse_dtheta": 0.024162765592336655,
      "rmse_dx": 0.0039230892434716225,
      "rmse_dy": 0.003009599167853594,
      "rmse_mean": 0.01036515086889267,
      "rotation_flip": 0.008456659503281116,
      "sparse_tokens": 32105.0,
      "step": 4055,
      "turn_loss": 0.060274090617895126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.1884408102583163,
      "grad_norm": 0.5864176154136658,
      "learning_rate": 7.528572042341954e-06,
      "loss": 0.1488,
      "mae_dtheta": 0.02542043663561344,
      "mae_dx": 0.013611343689262867,
      "mae_dy": 0.0033386650029569864,
      "pose_mae_dtheta": 0.19321677088737488,
      "pose_mae_dx": 0.11216764152050018,
      "pose_mae_dy": 0.05536169558763504,
      "pose_rmse_dtheta": 0.3798912465572357,
      "pose_rmse_dx": 0.2767590284347534,
      "pose_rmse_dy": 0.12290196120738983,
      "pose_rmse_mean": 0.25985077023506165,
      "rmse_dtheta": 0.04290135204792023,
      "rmse_dx": 0.029084013774991035,
      "rmse_dy": 0.006645521614700556,
      "rmse_mean": 0.026210296899080276,
      "rotation_flip": 0.014720314182341099,
      "sparse_tokens": 22438.0,
      "step": 4056,
      "turn_loss": 0.19196371734142303,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.18848727002415908,
      "grad_norm": 0.549216628074646,
      "learning_rate": 7.527431274237149e-06,
      "loss": 0.1812,
      "mae_dtheta": 0.034570977091789246,
      "mae_dx": 0.012410189025104046,
      "mae_dy": 0.004703677259385586,
      "pose_mae_dtheta": 0.26745861768722534,
      "pose_mae_dx": 0.10705199092626572,
      "pose_mae_dy": 0.059884212911129,
      "pose_rmse_dtheta": 0.4562021493911743,
      "pose_rmse_dx": 0.23693527281284332,
      "pose_rmse_dy": 0.12737642228603363,
      "pose_rmse_mean": 0.2735046148300171,
      "rmse_dtheta": 0.05285399779677391,
      "rmse_dx": 0.025352079421281815,
      "rmse_dy": 0.009149884805083275,
      "rmse_mean": 0.029118655249476433,
      "rotation_flip": 0.013513513840734959,
      "sparse_tokens": 15196.0,
      "step": 4057,
      "turn_loss": 0.273128479719162,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 6843.0,
      "epoch": 0.18853372979000185,
      "grad_norm": 0.4839596450328827,
      "learning_rate": 7.52629032938772e-06,
      "loss": 0.1483,
      "mae_dtheta": 0.026432078331708908,
      "mae_dx": 0.014512920752167702,
      "mae_dy": 0.004622314590960741,
      "pose_mae_dtheta": 0.17732581496238708,
      "pose_mae_dx": 0.11518431454896927,
      "pose_mae_dy": 0.06356699764728546,
      "pose_rmse_dtheta": 0.39697447419166565,
      "pose_rmse_dx": 0.27923351526260376,
      "pose_rmse_dy": 0.12325244396924973,
      "pose_rmse_mean": 0.2664868235588074,
      "rmse_dtheta": 0.0478915311396122,
      "rmse_dx": 0.029489127919077873,
      "rmse_dy": 0.008037165738642216,
      "rmse_mean": 0.02847260795533657,
      "rotation_flip": 0.013937282375991344,
      "sparse_tokens": 5625.0,
      "step": 4058,
      "turn_loss": 0.18333087861537933,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.18858018955584463,
      "grad_norm": 0.4254121780395508,
      "learning_rate": 7.5251492078734515e-06,
      "loss": 0.1225,
      "mae_dtheta": 0.03473556786775589,
      "mae_dx": 0.01383252814412117,
      "mae_dy": 0.0032427699770778418,
      "pose_mae_dtheta": 0.2991873621940613,
      "pose_mae_dx": 0.11010728031396866,
      "pose_mae_dy": 0.0369582325220108,
      "pose_rmse_dtheta": 0.5066608190536499,
      "pose_rmse_dx": 0.24970337748527527,
      "pose_rmse_dy": 0.08550871163606644,
      "pose_rmse_mean": 0.2806243300437927,
      "rmse_dtheta": 0.05240056291222572,
      "rmse_dx": 0.027353890240192413,
      "rmse_dy": 0.006261822767555714,
      "rmse_mean": 0.028672095388174057,
      "rotation_flip": 0.010600706562399864,
      "sparse_tokens": 16749.0,
      "step": 4059,
      "turn_loss": 0.25309330224990845,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1886266493216874,
      "grad_norm": 0.4716061055660248,
      "learning_rate": 7.5240079097741425e-06,
      "loss": 0.0946,
      "mae_dtheta": 0.010426390916109085,
      "mae_dx": 0.0018809798639267683,
      "mae_dy": 0.0024542829487472773,
      "pose_mae_dtheta": 0.06106047332286835,
      "pose_mae_dx": 0.022688742727041245,
      "pose_mae_dy": 0.029398078098893166,
      "pose_rmse_dtheta": 0.11934154480695724,
      "pose_rmse_dx": 0.05087885633111,
      "pose_rmse_dy": 0.06715485453605652,
      "pose_rmse_mean": 0.07912509143352509,
      "rmse_dtheta": 0.020722614601254463,
      "rmse_dx": 0.005133326165378094,
      "rmse_dy": 0.005178423132747412,
      "rmse_mean": 0.010344788432121277,
      "rotation_flip": 0.009893455542623997,
      "sparse_tokens": 32105.0,
      "step": 4060,
      "turn_loss": 0.09747358411550522,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1886731090875302,
      "grad_norm": 0.4793493151664734,
      "learning_rate": 7.522866435169606e-06,
      "loss": 0.0838,
      "mae_dtheta": 0.0077113802544772625,
      "mae_dx": 0.0012743915431201458,
      "mae_dy": 0.001255143666639924,
      "pose_mae_dtheta": 0.059067510068416595,
      "pose_mae_dx": 0.013215253129601479,
      "pose_mae_dy": 0.018006298691034317,
      "pose_rmse_dtheta": 0.20532533526420593,
      "pose_rmse_dx": 0.03521411493420601,
      "pose_rmse_dy": 0.047684431076049805,
      "pose_rmse_mean": 0.09607462584972382,
      "rmse_dtheta": 0.023197602480649948,
      "rmse_dx": 0.00390737084671855,
      "rmse_dy": 0.0027380986139178276,
      "rmse_mean": 0.009947691112756729,
      "rotation_flip": 0.0030287732370197773,
      "sparse_tokens": 32105.0,
      "step": 4061,
      "turn_loss": 0.05280159413814545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.188719568853373,
      "grad_norm": 0.43647101521492004,
      "learning_rate": 7.521724784139668e-06,
      "loss": 0.1137,
      "mae_dtheta": 0.03288339078426361,
      "mae_dx": 0.01276311930269003,
      "mae_dy": 0.007047475315630436,
      "pose_mae_dtheta": 0.28205788135528564,
      "pose_mae_dx": 0.1253715306520462,
      "pose_mae_dy": 0.09559913724660873,
      "pose_rmse_dtheta": 0.5409613847732544,
      "pose_rmse_dx": 0.2439192533493042,
      "pose_rmse_dy": 0.1937287151813507,
      "pose_rmse_mean": 0.3262031078338623,
      "rmse_dtheta": 0.05393138900399208,
      "rmse_dx": 0.02533998340368271,
      "rmse_dy": 0.01338122971355915,
      "rmse_mean": 0.03088420256972313,
      "rotation_flip": 0.008928571827709675,
      "sparse_tokens": 7094.0,
      "step": 4062,
      "turn_loss": 0.3355857729911804,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18876602861921576,
      "grad_norm": 0.4924602210521698,
      "learning_rate": 7.52058295676416e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.010822620242834091,
      "mae_dx": 0.0014842875534668565,
      "mae_dy": 0.002325815847143531,
      "pose_mae_dtheta": 0.07600253075361252,
      "pose_mae_dx": 0.020568616688251495,
      "pose_mae_dy": 0.03447653725743294,
      "pose_rmse_dtheta": 0.19340305030345917,
      "pose_rmse_dx": 0.05297045782208443,
      "pose_rmse_dy": 0.07258099317550659,
      "pose_rmse_mean": 0.1063181683421135,
      "rmse_dtheta": 0.02368004620075226,
      "rmse_dx": 0.004759710282087326,
      "rmse_dy": 0.005476794205605984,
      "rmse_mean": 0.011305517517030239,
      "rotation_flip": 0.003581020515412092,
      "sparse_tokens": 32057.0,
      "step": 4063,
      "turn_loss": 0.07824920117855072,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25556.0,
      "epoch": 0.18881248838505854,
      "grad_norm": 0.5285255312919617,
      "learning_rate": 7.519440953122934e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.037796493619680405,
      "mae_dx": 0.014351517893373966,
      "mae_dy": 0.004384701605886221,
      "pose_mae_dtheta": 0.3309231996536255,
      "pose_mae_dx": 0.10678938031196594,
      "pose_mae_dy": 0.06370776891708374,
      "pose_rmse_dtheta": 0.5730822682380676,
      "pose_rmse_dx": 0.22929207980632782,
      "pose_rmse_dy": 0.15366853773593903,
      "pose_rmse_mean": 0.3186809718608856,
      "rmse_dtheta": 0.056636132299900055,
      "rmse_dx": 0.027493543922901154,
      "rmse_dy": 0.008234460838139057,
      "rmse_mean": 0.03078804723918438,
      "rotation_flip": 0.01663893461227417,
      "sparse_tokens": 19471.0,
      "step": 4064,
      "turn_loss": 0.259925901889801,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 24663.0,
      "epoch": 0.18885894815090132,
      "grad_norm": 0.690140426158905,
      "learning_rate": 7.518298773295849e-06,
      "loss": 0.1391,
      "mae_dtheta": 0.03017519973218441,
      "mae_dx": 0.008501050062477589,
      "mae_dy": 0.0055513521656394005,
      "pose_mae_dtheta": 0.2273702472448349,
      "pose_mae_dx": 0.061457712203264236,
      "pose_mae_dy": 0.074482262134552,
      "pose_rmse_dtheta": 0.42935624718666077,
      "pose_rmse_dx": 0.1523951292037964,
      "pose_rmse_dy": 0.2054438441991806,
      "pose_rmse_mean": 0.2623984217643738,
      "rmse_dtheta": 0.048476692289114,
      "rmse_dx": 0.019686274230480194,
      "rmse_dy": 0.012077136896550655,
      "rmse_mean": 0.026746701449155807,
      "rotation_flip": 0.011775362305343151,
      "sparse_tokens": 19190.0,
      "step": 4065,
      "turn_loss": 0.21691055595874786,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.1889054079167441,
      "grad_norm": 1.0485352277755737,
      "learning_rate": 7.5171564173627795e-06,
      "loss": 0.279,
      "mae_dtheta": 0.04440156742930412,
      "mae_dx": 0.01710689626634121,
      "mae_dy": 0.009564708918333054,
      "pose_mae_dtheta": 0.34213095903396606,
      "pose_mae_dx": 0.14285513758659363,
      "pose_mae_dy": 0.09530700743198395,
      "pose_rmse_dtheta": 0.5992382764816284,
      "pose_rmse_dx": 0.262084037065506,
      "pose_rmse_dy": 0.202897846698761,
      "pose_rmse_mean": 0.35474008321762085,
      "rmse_dtheta": 0.063117116689682,
      "rmse_dx": 0.028646577149629593,
      "rmse_dy": 0.01961631514132023,
      "rmse_mean": 0.03712666779756546,
      "rotation_flip": 0.00974658876657486,
      "sparse_tokens": 8352.0,
      "step": 4066,
      "turn_loss": 0.4086749851703644,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.18895186768258687,
      "grad_norm": 0.4799267649650574,
      "learning_rate": 7.516013885403611e-06,
      "loss": 0.162,
      "mae_dtheta": 0.036498989909887314,
      "mae_dx": 0.013927175663411617,
      "mae_dy": 0.006674002390354872,
      "pose_mae_dtheta": 0.3011801838874817,
      "pose_mae_dx": 0.10368321090936661,
      "pose_mae_dy": 0.09669367223978043,
      "pose_rmse_dtheta": 0.5129010677337646,
      "pose_rmse_dx": 0.2111317664384842,
      "pose_rmse_dy": 0.22107890248298645,
      "pose_rmse_mean": 0.31503725051879883,
      "rmse_dtheta": 0.053827788680791855,
      "rmse_dx": 0.026758288964629173,
      "rmse_dy": 0.013186618685722351,
      "rmse_mean": 0.031257566064596176,
      "rotation_flip": 0.014147431589663029,
      "sparse_tokens": 22016.0,
      "step": 4067,
      "turn_loss": 0.2976003885269165,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.18899832744842965,
      "grad_norm": 0.4337667226791382,
      "learning_rate": 7.5148711774982415e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.03465953469276428,
      "mae_dx": 0.013126696459949017,
      "mae_dy": 0.00691359443590045,
      "pose_mae_dtheta": 0.2969816327095032,
      "pose_mae_dx": 0.09913931041955948,
      "pose_mae_dy": 0.08189410716295242,
      "pose_rmse_dtheta": 0.5276363492012024,
      "pose_rmse_dx": 0.22287379205226898,
      "pose_rmse_dy": 0.18824242055416107,
      "pose_rmse_mean": 0.3129175305366516,
      "rmse_dtheta": 0.054172348231077194,
      "rmse_dx": 0.026026468724012375,
      "rmse_dy": 0.013356533832848072,
      "rmse_mean": 0.031185118481516838,
      "rotation_flip": 0.014689265750348568,
      "sparse_tokens": 13564.0,
      "step": 4068,
      "turn_loss": 0.2609296143054962,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.18904478721427245,
      "grad_norm": 0.6409502625465393,
      "learning_rate": 7.5137282937265796e-06,
      "loss": 0.1235,
      "mae_dtheta": 0.028838282451033592,
      "mae_dx": 0.011624252423644066,
      "mae_dy": 0.0040630921721458435,
      "pose_mae_dtheta": 0.21460328996181488,
      "pose_mae_dx": 0.08777614682912827,
      "pose_mae_dy": 0.03809469938278198,
      "pose_rmse_dtheta": 0.3814318776130676,
      "pose_rmse_dx": 0.20631468296051025,
      "pose_rmse_dy": 0.0942249745130539,
      "pose_rmse_mean": 0.22732385993003845,
      "rmse_dtheta": 0.046362653374671936,
      "rmse_dx": 0.024182572960853577,
      "rmse_dy": 0.008181337267160416,
      "rmse_mean": 0.02624218724668026,
      "rotation_flip": 0.02332361601293087,
      "sparse_tokens": 11122.0,
      "step": 4069,
      "turn_loss": 0.22836123406887054,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18909124698011523,
      "grad_norm": 0.5901132822036743,
      "learning_rate": 7.5125852341685505e-06,
      "loss": 0.1332,
      "mae_dtheta": 0.011606908403337002,
      "mae_dx": 0.002055202377960086,
      "mae_dy": 0.002491672057658434,
      "pose_mae_dtheta": 0.08012928813695908,
      "pose_mae_dx": 0.027043422684073448,
      "pose_mae_dy": 0.03382416442036629,
      "pose_rmse_dtheta": 0.17937570810317993,
      "pose_rmse_dx": 0.06923716515302658,
      "pose_rmse_dy": 0.07356453686952591,
      "pose_rmse_mean": 0.10739247500896454,
      "rmse_dtheta": 0.022786680608987808,
      "rmse_dx": 0.006745960097759962,
      "rmse_dy": 0.005116666201502085,
      "rmse_mean": 0.011549769900739193,
      "rotation_flip": 0.0032586557790637016,
      "sparse_tokens": 32057.0,
      "step": 4070,
      "turn_loss": 0.09390915930271149,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.189137706745958,
      "grad_norm": 0.638989269733429,
      "learning_rate": 7.5114419989040856e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.030884474515914917,
      "mae_dx": 0.017336977645754814,
      "mae_dy": 0.007125603500753641,
      "pose_mae_dtheta": 0.2376372218132019,
      "pose_mae_dx": 0.13984467089176178,
      "pose_mae_dy": 0.0904136672616005,
      "pose_rmse_dtheta": 0.37227994203567505,
      "pose_rmse_dx": 0.28768596053123474,
      "pose_rmse_dy": 0.17723439633846283,
      "pose_rmse_mean": 0.2790667712688446,
      "rmse_dtheta": 0.04396083578467369,
      "rmse_dx": 0.0313810370862484,
      "rmse_dy": 0.010670371353626251,
      "rmse_mean": 0.028670748695731163,
      "rotation_flip": 0.027303753420710564,
      "sparse_tokens": 4983.0,
      "step": 4071,
      "turn_loss": 0.3133581578731537,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.18918416651180078,
      "grad_norm": 0.5520703792572021,
      "learning_rate": 7.510298588013135e-06,
      "loss": 0.1556,
      "mae_dtheta": 0.02764151245355606,
      "mae_dx": 0.008271715603768826,
      "mae_dy": 0.002401951001957059,
      "pose_mae_dtheta": 0.22041769325733185,
      "pose_mae_dx": 0.06800004839897156,
      "pose_mae_dy": 0.03230492025613785,
      "pose_rmse_dtheta": 0.42876890301704407,
      "pose_rmse_dx": 0.19390301406383514,
      "pose_rmse_dy": 0.0699998140335083,
      "pose_rmse_mean": 0.23089057207107544,
      "rmse_dtheta": 0.04574346914887428,
      "rmse_dx": 0.020249495282769203,
      "rmse_dy": 0.004507189150899649,
      "rmse_mean": 0.023500053212046623,
      "rotation_flip": 0.00538599630817771,
      "sparse_tokens": 8919.0,
      "step": 4072,
      "turn_loss": 0.20120026171207428,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.18923062627764356,
      "grad_norm": 0.40318939089775085,
      "learning_rate": 7.509155001575656e-06,
      "loss": 0.09,
      "mae_dtheta": 0.00425582705065608,
      "mae_dx": 0.0009672205778770149,
      "mae_dy": 0.000713001936674118,
      "pose_mae_dtheta": 0.029387103393673897,
      "pose_mae_dx": 0.010053100995719433,
      "pose_mae_dy": 0.011420030146837234,
      "pose_rmse_dtheta": 0.10580965876579285,
      "pose_rmse_dx": 0.02620808593928814,
      "pose_rmse_dy": 0.029005540534853935,
      "pose_rmse_mean": 0.05367442965507507,
      "rmse_dtheta": 0.013523677363991737,
      "rmse_dx": 0.003033666405826807,
      "rmse_dy": 0.001496859360486269,
      "rmse_mean": 0.0060180677101016045,
      "rotation_flip": 0.0012322858674451709,
      "sparse_tokens": 32105.0,
      "step": 4073,
      "turn_loss": 0.04320789501070976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.18927708604348634,
      "grad_norm": 0.6882568597793579,
      "learning_rate": 7.508011239671622e-06,
      "loss": 0.165,
      "mae_dtheta": 0.02292179875075817,
      "mae_dx": 0.008190080523490906,
      "mae_dy": 0.004372545517981052,
      "pose_mae_dtheta": 0.1594620943069458,
      "pose_mae_dx": 0.060665544122457504,
      "pose_mae_dy": 0.051700133830308914,
      "pose_rmse_dtheta": 0.29071539640426636,
      "pose_rmse_dx": 0.14539310336112976,
      "pose_rmse_dy": 0.11595466732978821,
      "pose_rmse_mean": 0.18402105569839478,
      "rmse_dtheta": 0.03744665905833244,
      "rmse_dx": 0.019127918407320976,
      "rmse_dy": 0.008913835510611534,
      "rmse_mean": 0.021829470992088318,
      "rotation_flip": 0.008888889104127884,
      "sparse_tokens": 13172.0,
      "step": 4074,
      "turn_loss": 0.2111394852399826,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.1893235458093291,
      "grad_norm": 0.7300814390182495,
      "learning_rate": 7.506867302381016e-06,
      "loss": 0.1772,
      "mae_dtheta": 0.030099429190158844,
      "mae_dx": 0.011164274998009205,
      "mae_dy": 0.00456455210223794,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7300817370414734,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.81387329101562,
      "model/head/act_norm_mean": 108.47302776834239,
      "model/head/act_norm_min": 78.36856079101562,
      "model/head/act_over_embed": 74.54368022289096,
      "model/head/grad_frac": 0.09032116830348969,
      "model/head/grad_norm": 0.06594183295965195,
      "model/head/grad_zero_frac": 0.0001583186094649136,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.686905570652174,
      "model/head/update_ratio": 0.0011329330736771226,
      "model/head/weight_delta": 7.535128116607666,
      "model/head/weight_delta_rel": 0.13218846917152405,
      "model/head/weight_norm": 58.204524993896484,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4176727831363678,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4176727831363678,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4176727831363678,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28702864688551566,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05427415296435356,
      "model/modality_embedder.encoders.pose/grad_norm": 0.039624568074941635,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012833061628043652,
      "model/modality_embedder.encoders.pose/weight_delta": 2.466914415359497,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0806017816066742,
      "model/modality_embedder.encoders.pose/weight_norm": 30.87693977355957,
      "model/modality_embedder/grad_frac": 0.05427415296435356,
      "model/modality_embedder/grad_norm": 0.039624568074941635,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0012833061628043652,
      "model/modality_embedder/weight_delta": 2.466914415359497,
      "model/modality_embedder/weight_delta_rel": 0.0806017816066742,
      "model/modality_embedder/weight_norm": 30.87693977355957,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.75550079345703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.41610863095238,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.108305931091309,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.091769076253424,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08398334681987762,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06131470575928688,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0022092843428254128,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.7727336883544922,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06459948420524597,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.753198623657227,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.18101501464844,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.29908557625949,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.878573417663574,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.698559099628877,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07291622459888458,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.053234804421663284,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018091279780492187,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.2411558628082275,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07763539254665375,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.425670623779297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.27742767333984,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.98196762853692,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.107889175415039,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.85505140134393,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07333406060934067,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.053539857268333435,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017624195897951722,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.4051876068115234,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08076169341802597,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.378610610961914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.46835327148438,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.87313179347826,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.025589942932129,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.154677120849485,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06609175354242325,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04825238138437271,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001625308534130454,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.0528597831726074,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0701570063829422,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.68813705444336,
      "model/normalizer/grad_frac": 0.2702682912349701,
      "model/normalizer/grad_norm": 0.1973179429769516,
      "model/normalizer/grad_zero_frac": 0.00018435118545312434,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0025209332816302776,
      "model/normalizer/weight_delta": 4.361471652984619,
      "model/normalizer/weight_delta_rel": 0.056173231452703476,
      "model/normalizer/weight_norm": 78.27178192138672,
      "pose_mae_dtheta": 0.21382193267345428,
      "pose_mae_dx": 0.08203182369470596,
      "pose_mae_dy": 0.08071865141391754,
      "pose_rmse_dtheta": 0.3709525763988495,
      "pose_rmse_dx": 0.15124960243701935,
      "pose_rmse_dy": 0.16586969792842865,
      "pose_rmse_mean": 0.2293573021888733,
      "rmse_dtheta": 0.043660540133714676,
      "rmse_dx": 0.020989296957850456,
      "rmse_dy": 0.008553135208785534,
      "rmse_mean": 0.024400990456342697,
      "rotation_flip": 0.010498687624931335,
      "sparse_tokens": 6634.0,
      "step": 4075,
      "turn_loss": 0.2161228358745575,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.1893700055751719,
      "grad_norm": 0.7424688935279846,
      "learning_rate": 7.505723189783831e-06,
      "loss": 0.166,
      "mae_dtheta": 0.03567655384540558,
      "mae_dx": 0.008581874892115593,
      "mae_dy": 0.002703386824578047,
      "pose_mae_dtheta": 0.2679118812084198,
      "pose_mae_dx": 0.0600416474044323,
      "pose_mae_dy": 0.03311534225940704,
      "pose_rmse_dtheta": 0.5039229989051819,
      "pose_rmse_dx": 0.13233420252799988,
      "pose_rmse_dy": 0.12451596558094025,
      "pose_rmse_mean": 0.25359106063842773,
      "rmse_dtheta": 0.05638180300593376,
      "rmse_dx": 0.018613703548908234,
      "rmse_dy": 0.006395559757947922,
      "rmse_mean": 0.027130356058478355,
      "rotation_flip": 0.010948904789984226,
      "sparse_tokens": 9335.0,
      "step": 4076,
      "turn_loss": 0.18678990006446838,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.1894164653410147,
      "grad_norm": 0.6070365905761719,
      "learning_rate": 7.504578901960081e-06,
      "loss": 0.1629,
      "mae_dtheta": 0.04147033393383026,
      "mae_dx": 0.014732889831066132,
      "mae_dy": 0.00810946710407734,
      "pose_mae_dtheta": 0.31473690271377563,
      "pose_mae_dx": 0.09477347880601883,
      "pose_mae_dy": 0.07775068283081055,
      "pose_rmse_dtheta": 0.5049364566802979,
      "pose_rmse_dx": 0.20501922070980072,
      "pose_rmse_dy": 0.16255201399326324,
      "pose_rmse_mean": 0.2908359169960022,
      "rmse_dtheta": 0.06033977493643761,
      "rmse_dx": 0.0275046955794096,
      "rmse_dy": 0.015650324523448944,
      "rmse_mean": 0.034498266875743866,
      "rotation_flip": 0.025844929739832878,
      "sparse_tokens": 8039.0,
      "step": 4077,
      "turn_loss": 0.36438190937042236,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.18946292510685747,
      "grad_norm": 0.8594551682472229,
      "learning_rate": 7.503434438989784e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.009641003794968128,
      "mae_dx": 0.0018963454058393836,
      "mae_dy": 0.0018659197958186269,
      "pose_mae_dtheta": 0.0620390847325325,
      "pose_mae_dx": 0.01825348660349846,
      "pose_mae_dy": 0.01983899436891079,
      "pose_rmse_dtheta": 0.16473448276519775,
      "pose_rmse_dx": 0.04233397915959358,
      "pose_rmse_dy": 0.05801045522093773,
      "pose_rmse_mean": 0.08835963904857635,
      "rmse_dtheta": 0.022589154541492462,
      "rmse_dx": 0.005260779056698084,
      "rmse_dy": 0.005400409922003746,
      "rmse_mean": 0.011083448305726051,
      "rotation_flip": 0.002320185536518693,
      "sparse_tokens": 32185.0,
      "step": 4078,
      "turn_loss": 0.07670038193464279,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18950938487270025,
      "grad_norm": 0.5514171719551086,
      "learning_rate": 7.5022898009529735e-06,
      "loss": 0.1403,
      "mae_dtheta": 0.008997681550681591,
      "mae_dx": 0.0014234428526833653,
      "mae_dy": 0.0016727937618270516,
      "pose_mae_dtheta": 0.06102748587727547,
      "pose_mae_dx": 0.016061803326010704,
      "pose_mae_dy": 0.0217761043459177,
      "pose_rmse_dtheta": 0.17714187502861023,
      "pose_rmse_dx": 0.043880775570869446,
      "pose_rmse_dy": 0.04943949729204178,
      "pose_rmse_mean": 0.09015405178070068,
      "rmse_dtheta": 0.022389084100723267,
      "rmse_dx": 0.004378362093120813,
      "rmse_dy": 0.0036488277837634087,
      "rmse_mean": 0.010138757526874542,
      "rotation_flip": 0.003122212365269661,
      "sparse_tokens": 32089.0,
      "step": 4079,
      "turn_loss": 0.06302907317876816,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.18955584463854303,
      "grad_norm": 0.705290675163269,
      "learning_rate": 7.501144987929693e-06,
      "loss": 0.1339,
      "mae_dtheta": 0.031382862478494644,
      "mae_dx": 0.010236524976789951,
      "mae_dy": 0.003682964714244008,
      "pose_mae_dtheta": 0.24588100612163544,
      "pose_mae_dx": 0.08229373395442963,
      "pose_mae_dy": 0.032606273889541626,
      "pose_rmse_dtheta": 0.42404982447624207,
      "pose_rmse_dx": 0.20065321028232574,
      "pose_rmse_dy": 0.07847152650356293,
      "pose_rmse_mean": 0.23439154028892517,
      "rmse_dtheta": 0.049838583916425705,
      "rmse_dx": 0.021766765043139458,
      "rmse_dy": 0.008216305635869503,
      "rmse_mean": 0.026607219129800797,
      "rotation_flip": 0.012331838719546795,
      "sparse_tokens": 15042.0,
      "step": 4080,
      "turn_loss": 0.2628929316997528,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1896023044043858,
      "grad_norm": 0.5033103227615356,
      "learning_rate": 7.500000000000001e-06,
      "loss": 0.1338,
      "mae_dtheta": 0.01235732901841402,
      "mae_dx": 0.003342383773997426,
      "mae_dy": 0.0029019906651228666,
      "pose_mae_dtheta": 0.08984452486038208,
      "pose_mae_dx": 0.028834091499447823,
      "pose_mae_dy": 0.023575695231556892,
      "pose_rmse_dtheta": 0.2434983104467392,
      "pose_rmse_dx": 0.08442582935094833,
      "pose_rmse_dy": 0.05529438331723213,
      "pose_rmse_mean": 0.12773951888084412,
      "rmse_dtheta": 0.029360709711909294,
      "rmse_dx": 0.010464388877153397,
      "rmse_dy": 0.008874442428350449,
      "rmse_mean": 0.016233179718255997,
      "rotation_flip": 0.002219263231381774,
      "sparse_tokens": 32105.0,
      "step": 4081,
      "turn_loss": 0.13579002022743225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.18964876417022858,
      "grad_norm": 0.7079365253448486,
      "learning_rate": 7.498854837243967e-06,
      "loss": 0.0939,
      "mae_dtheta": 0.008668876253068447,
      "mae_dx": 0.0015548482770100236,
      "mae_dy": 0.0025220855604857206,
      "pose_mae_dtheta": 0.05671640858054161,
      "pose_mae_dx": 0.021358907222747803,
      "pose_mae_dy": 0.0266382098197937,
      "pose_rmse_dtheta": 0.11803176254034042,
      "pose_rmse_dx": 0.06184462457895279,
      "pose_rmse_dy": 0.0634961724281311,
      "pose_rmse_mean": 0.0811241865158081,
      "rmse_dtheta": 0.01777578517794609,
      "rmse_dx": 0.004947955720126629,
      "rmse_dy": 0.00553645147010684,
      "rmse_mean": 0.009420065209269524,
      "rotation_flip": 0.0060759494081139565,
      "sparse_tokens": 32025.0,
      "step": 4082,
      "turn_loss": 0.07382602244615555,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.18969522393607136,
      "grad_norm": 0.6515957713127136,
      "learning_rate": 7.497709499741673e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.006726071238517761,
      "mae_dx": 0.0020445729605853558,
      "mae_dy": 0.0009562204359099269,
      "pose_mae_dtheta": 0.050025444477796555,
      "pose_mae_dx": 0.019826769828796387,
      "pose_mae_dy": 0.014570312574505806,
      "pose_rmse_dtheta": 0.14580091834068298,
      "pose_rmse_dx": 0.0518641471862793,
      "pose_rmse_dy": 0.03654663264751434,
      "pose_rmse_mean": 0.07807056605815887,
      "rmse_dtheta": 0.018246565014123917,
      "rmse_dx": 0.006680123973637819,
      "rmse_dy": 0.002051582559943199,
      "rmse_mean": 0.008992757648229599,
      "rotation_flip": 0.00620732456445694,
      "sparse_tokens": 32089.0,
      "step": 4083,
      "turn_loss": 0.06477810442447662,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.18974168370191413,
      "grad_norm": 0.5247679352760315,
      "learning_rate": 7.4965639875732146e-06,
      "loss": 0.1336,
      "mae_dtheta": 0.012815103866159916,
      "mae_dx": 0.0027507480699568987,
      "mae_dy": 0.0036050209309905767,
      "pose_mae_dtheta": 0.08605945110321045,
      "pose_mae_dx": 0.03436791151762009,
      "pose_mae_dy": 0.035710591822862625,
      "pose_rmse_dtheta": 0.2150772511959076,
      "pose_rmse_dx": 0.09980139136314392,
      "pose_rmse_dy": 0.11179578304290771,
      "pose_rmse_mean": 0.14222481846809387,
      "rmse_dtheta": 0.027939729392528534,
      "rmse_dx": 0.00775266345590353,
      "rmse_dy": 0.008464572951197624,
      "rmse_mean": 0.014718989841639996,
      "rotation_flip": 0.005160778295248747,
      "sparse_tokens": 32121.0,
      "step": 4084,
      "turn_loss": 0.1258779764175415,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1897881434677569,
      "grad_norm": 0.3765023946762085,
      "learning_rate": 7.495418300818696e-06,
      "loss": 0.0775,
      "mae_dtheta": 0.007937375456094742,
      "mae_dx": 0.0013426460791379213,
      "mae_dy": 0.0017002120148390532,
      "pose_mae_dtheta": 0.05347782000899315,
      "pose_mae_dx": 0.018589938059449196,
      "pose_mae_dy": 0.024064788594841957,
      "pose_rmse_dtheta": 0.1394360363483429,
      "pose_rmse_dx": 0.0485217459499836,
      "pose_rmse_dy": 0.06204091012477875,
      "pose_rmse_mean": 0.08333289623260498,
      "rmse_dtheta": 0.0205242857336998,
      "rmse_dx": 0.00411679781973362,
      "rmse_dy": 0.004219936206936836,
      "rmse_mean": 0.009620340541005135,
      "rotation_flip": 0.004887585528194904,
      "sparse_tokens": 32073.0,
      "step": 4085,
      "turn_loss": 0.06381024420261383,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.1898346032335997,
      "grad_norm": 1.080876350402832,
      "learning_rate": 7.494272439558235e-06,
      "loss": 0.3142,
      "mae_dtheta": 0.03973187506198883,
      "mae_dx": 0.013183636590838432,
      "mae_dy": 0.00361100141890347,
      "pose_mae_dtheta": 0.2957012951374054,
      "pose_mae_dx": 0.12227781862020493,
      "pose_mae_dy": 0.03719175606966019,
      "pose_rmse_dtheta": 0.48445406556129456,
      "pose_rmse_dx": 0.2641122043132782,
      "pose_rmse_dy": 0.07319935411214828,
      "pose_rmse_mean": 0.2739218771457672,
      "rmse_dtheta": 0.05641070008277893,
      "rmse_dx": 0.025941088795661926,
      "rmse_dy": 0.0077841561287641525,
      "rmse_mean": 0.030045315623283386,
      "rotation_flip": 0.021043000742793083,
      "sparse_tokens": 16008.0,
      "step": 4086,
      "turn_loss": 0.2901245355606079,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.1898810629994425,
      "grad_norm": 0.6457973718643188,
      "learning_rate": 7.493126403871964e-06,
      "loss": 0.1998,
      "mae_dtheta": 0.019498653709888458,
      "mae_dx": 0.006267363205552101,
      "mae_dy": 0.004917257931083441,
      "pose_mae_dtheta": 0.11104152351617813,
      "pose_mae_dx": 0.03964824229478836,
      "pose_mae_dy": 0.05491452291607857,
      "pose_rmse_dtheta": 0.1925411820411682,
      "pose_rmse_dx": 0.0866059809923172,
      "pose_rmse_dy": 0.11268340051174164,
      "pose_rmse_mean": 0.13061019778251648,
      "rmse_dtheta": 0.030345695093274117,
      "rmse_dx": 0.016355033963918686,
      "rmse_dy": 0.00935283675789833,
      "rmse_mean": 0.018684523180127144,
      "rotation_flip": 0.0031545741949230433,
      "sparse_tokens": 5170.0,
      "step": 4087,
      "turn_loss": 0.21047133207321167,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.18992752276528527,
      "grad_norm": 0.46826156973838806,
      "learning_rate": 7.491980193840027e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.013598684221506119,
      "mae_dx": 0.0021155644208192825,
      "mae_dy": 0.0034365307074040174,
      "pose_mae_dtheta": 0.0902111753821373,
      "pose_mae_dx": 0.027432741597294807,
      "pose_mae_dy": 0.044646576046943665,
      "pose_rmse_dtheta": 0.19003307819366455,
      "pose_rmse_dx": 0.06059170514345169,
      "pose_rmse_dy": 0.1039671003818512,
      "pose_rmse_mean": 0.11819729208946228,
      "rmse_dtheta": 0.027268489822745323,
      "rmse_dx": 0.006847607437521219,
      "rmse_dy": 0.00833918061107397,
      "rmse_mean": 0.014151759445667267,
      "rotation_flip": 0.009734181687235832,
      "sparse_tokens": 32057.0,
      "step": 4088,
      "turn_loss": 0.11415586620569229,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.18997398253112804,
      "grad_norm": 0.526781439781189,
      "learning_rate": 7.490833809542576e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.014481207355856895,
      "mae_dx": 0.002644613152369857,
      "mae_dy": 0.004194656386971474,
      "pose_mae_dtheta": 0.09603522717952728,
      "pose_mae_dx": 0.03192160278558731,
      "pose_mae_dy": 0.041463397443294525,
      "pose_rmse_dtheta": 0.20306962728500366,
      "pose_rmse_dx": 0.06959684193134308,
      "pose_rmse_dy": 0.08487188816070557,
      "pose_rmse_mean": 0.11917944997549057,
      "rmse_dtheta": 0.02690894901752472,
      "rmse_dx": 0.007626211736351252,
      "rmse_dy": 0.00954811554402113,
      "rmse_mean": 0.014694426208734512,
      "rotation_flip": 0.005782312713563442,
      "sparse_tokens": 32073.0,
      "step": 4089,
      "turn_loss": 0.1171736791729927,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.19002044229697082,
      "grad_norm": 2.060360908508301,
      "learning_rate": 7.48968725105978e-06,
      "loss": 0.2754,
      "mae_dtheta": 0.025396496057510376,
      "mae_dx": 0.02023264952003956,
      "mae_dy": 0.004879819229245186,
      "pose_mae_dtheta": 0.17397411167621613,
      "pose_mae_dx": 0.18003533780574799,
      "pose_mae_dy": 0.05618907883763313,
      "pose_rmse_dtheta": 0.3417261242866516,
      "pose_rmse_dx": 0.33187049627304077,
      "pose_rmse_dy": 0.10380197316408157,
      "pose_rmse_mean": 0.25913286209106445,
      "rmse_dtheta": 0.03985121473670006,
      "rmse_dx": 0.0333845317363739,
      "rmse_dy": 0.007809831295162439,
      "rmse_mean": 0.027015194296836853,
      "rotation_flip": 0.011450381949543953,
      "sparse_tokens": 4526.0,
      "step": 4090,
      "turn_loss": 0.32098209857940674,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1900669020628136,
      "grad_norm": 0.4035579264163971,
      "learning_rate": 7.488540518471819e-06,
      "loss": 0.0812,
      "mae_dtheta": 0.008819417096674442,
      "mae_dx": 0.0014482258120551705,
      "mae_dy": 0.0013326725456863642,
      "pose_mae_dtheta": 0.06371519714593887,
      "pose_mae_dx": 0.015525209717452526,
      "pose_mae_dy": 0.015031777322292328,
      "pose_rmse_dtheta": 0.219765305519104,
      "pose_rmse_dx": 0.037294574081897736,
      "pose_rmse_dy": 0.04282793775200844,
      "pose_rmse_mean": 0.09996260702610016,
      "rmse_dtheta": 0.024997686967253685,
      "rmse_dx": 0.0037977274041622877,
      "rmse_dy": 0.003403417067602277,
      "rmse_mean": 0.010732944123446941,
      "rotation_flip": 0.0047961631789803505,
      "sparse_tokens": 32153.0,
      "step": 4091,
      "turn_loss": 0.05421217903494835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.19011336182865637,
      "grad_norm": 0.48331233859062195,
      "learning_rate": 7.487393611858883e-06,
      "loss": 0.1295,
      "mae_dtheta": 0.04195487126708031,
      "mae_dx": 0.01697041653096676,
      "mae_dy": 0.005620503798127174,
      "pose_mae_dtheta": 0.3062793016433716,
      "pose_mae_dx": 0.1337718516588211,
      "pose_mae_dy": 0.05933704227209091,
      "pose_rmse_dtheta": 0.5220212936401367,
      "pose_rmse_dx": 0.24612385034561157,
      "pose_rmse_dy": 0.11800282448530197,
      "pose_rmse_mean": 0.29538267850875854,
      "rmse_dtheta": 0.05692403018474579,
      "rmse_dx": 0.028930218890309334,
      "rmse_dy": 0.009487506002187729,
      "rmse_mean": 0.031780585646629333,
      "rotation_flip": 0.010958904400467873,
      "sparse_tokens": 5832.0,
      "step": 4092,
      "turn_loss": 0.3590109348297119,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19015982159449915,
      "grad_norm": 0.5934627056121826,
      "learning_rate": 7.486246531301178e-06,
      "loss": 0.1061,
      "mae_dtheta": 0.008037852123379707,
      "mae_dx": 0.0022369485814124346,
      "mae_dy": 0.0017337893368676305,
      "pose_mae_dtheta": 0.061158228665590286,
      "pose_mae_dx": 0.019690072163939476,
      "pose_mae_dy": 0.021618658676743507,
      "pose_rmse_dtheta": 0.1592312604188919,
      "pose_rmse_dx": 0.06363151967525482,
      "pose_rmse_dy": 0.0688144862651825,
      "pose_rmse_mean": 0.09722575545310974,
      "rmse_dtheta": 0.019904283806681633,
      "rmse_dx": 0.008444453589618206,
      "rmse_dy": 0.005451040342450142,
      "rmse_mean": 0.01126659195870161,
      "rotation_flip": 0.00918484479188919,
      "sparse_tokens": 32089.0,
      "step": 4093,
      "turn_loss": 0.0740392729640007,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.19020628136034196,
      "grad_norm": 0.5290176868438721,
      "learning_rate": 7.485099276878916e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.012538540177047253,
      "mae_dx": 0.0028133122250437737,
      "mae_dy": 0.0020434122998267412,
      "pose_mae_dtheta": 0.08785760402679443,
      "pose_mae_dx": 0.030965818092226982,
      "pose_mae_dy": 0.027948085218667984,
      "pose_rmse_dtheta": 0.2546333372592926,
      "pose_rmse_dx": 0.08036419004201889,
      "pose_rmse_dy": 0.08221693336963654,
      "pose_rmse_mean": 0.1390714943408966,
      "rmse_dtheta": 0.02968195453286171,
      "rmse_dx": 0.009028023108839989,
      "rmse_dy": 0.004823748953640461,
      "rmse_mean": 0.01451124157756567,
      "rotation_flip": 0.004473160952329636,
      "sparse_tokens": 32073.0,
      "step": 4094,
      "turn_loss": 0.10568592697381973,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.19025274112618473,
      "grad_norm": 1.0480891466140747,
      "learning_rate": 7.4839518486723295e-06,
      "loss": 0.2317,
      "mae_dtheta": 0.03390951827168465,
      "mae_dx": 0.014994388446211815,
      "mae_dy": 0.0047517502680420876,
      "pose_mae_dtheta": 0.2580425441265106,
      "pose_mae_dx": 0.12100809812545776,
      "pose_mae_dy": 0.06609091907739639,
      "pose_rmse_dtheta": 0.40637385845184326,
      "pose_rmse_dx": 0.24878063797950745,
      "pose_rmse_dy": 0.15257911384105682,
      "pose_rmse_mean": 0.26924455165863037,
      "rmse_dtheta": 0.05086823180317879,
      "rmse_dx": 0.028533361852169037,
      "rmse_dy": 0.008487389422953129,
      "rmse_mean": 0.029296329244971275,
      "rotation_flip": 0.005235602147877216,
      "sparse_tokens": 6519.0,
      "step": 4095,
      "turn_loss": 0.2085515558719635,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.1902992008920275,
      "grad_norm": 0.6533129215240479,
      "learning_rate": 7.482804246761657e-06,
      "loss": 0.1706,
      "mae_dtheta": 0.01573808304965496,
      "mae_dx": 0.00897887907922268,
      "mae_dy": 0.0032356835436075926,
      "pose_mae_dtheta": 0.13155516982078552,
      "pose_mae_dx": 0.07546486705541611,
      "pose_mae_dy": 0.04987918585538864,
      "pose_rmse_dtheta": 0.29052531719207764,
      "pose_rmse_dx": 0.18884555995464325,
      "pose_rmse_dy": 0.16706253588199615,
      "pose_rmse_mean": 0.2154778093099594,
      "rmse_dtheta": 0.031333792954683304,
      "rmse_dx": 0.021046575158834457,
      "rmse_dy": 0.007089653518050909,
      "rmse_mean": 0.019823340699076653,
      "rotation_flip": 0.0069204154424369335,
      "sparse_tokens": 13781.0,
      "step": 4096,
      "turn_loss": 0.14877818524837494,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.19034566065787029,
      "grad_norm": 0.8131094574928284,
      "learning_rate": 7.48165647122715e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.010674878023564816,
      "mae_dx": 0.0017376855248585343,
      "mae_dy": 0.002994685200974345,
      "pose_mae_dtheta": 0.07594893872737885,
      "pose_mae_dx": 0.02638433873653412,
      "pose_mae_dy": 0.032536234706640244,
      "pose_rmse_dtheta": 0.17520517110824585,
      "pose_rmse_dx": 0.06801234930753708,
      "pose_rmse_dy": 0.08423402905464172,
      "pose_rmse_mean": 0.10915052145719528,
      "rmse_dtheta": 0.021802052855491638,
      "rmse_dx": 0.005197578575462103,
      "rmse_dy": 0.007140877190977335,
      "rmse_mean": 0.011380169540643692,
      "rotation_flip": 0.0039200312457978725,
      "sparse_tokens": 32057.0,
      "step": 4097,
      "turn_loss": 0.09220030903816223,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30723.0,
      "epoch": 0.19039212042371306,
      "grad_norm": 0.6992881298065186,
      "learning_rate": 7.480508522149074e-06,
      "loss": 0.1195,
      "mae_dtheta": 0.03156958892941475,
      "mae_dx": 0.012644842267036438,
      "mae_dy": 0.006579345092177391,
      "pose_mae_dtheta": 0.25810444355010986,
      "pose_mae_dx": 0.11423905938863754,
      "pose_mae_dy": 0.0868072658777237,
      "pose_rmse_dtheta": 0.4382270574569702,
      "pose_rmse_dx": 0.22872504591941833,
      "pose_rmse_dy": 0.19013004004955292,
      "pose_rmse_mean": 0.28569406270980835,
      "rmse_dtheta": 0.047490473836660385,
      "rmse_dx": 0.024423323571681976,
      "rmse_dy": 0.013405514881014824,
      "rmse_mean": 0.028439771384000778,
      "rotation_flip": 0.012223071418702602,
      "sparse_tokens": 25392.0,
      "step": 4098,
      "turn_loss": 0.2685052752494812,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.19043858018955584,
      "grad_norm": 0.48367631435394287,
      "learning_rate": 7.479360399607707e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.007516071666032076,
      "mae_dx": 0.0011627590283751488,
      "mae_dy": 0.0009490343509241939,
      "pose_mae_dtheta": 0.055174753069877625,
      "pose_mae_dx": 0.012255558744072914,
      "pose_mae_dy": 0.015456647612154484,
      "pose_rmse_dtheta": 0.1976780891418457,
      "pose_rmse_dx": 0.030603889375925064,
      "pose_rmse_dy": 0.03928094729781151,
      "pose_rmse_mean": 0.08918764442205429,
      "rmse_dtheta": 0.022660689428448677,
      "rmse_dx": 0.0035971179604530334,
      "rmse_dy": 0.002035313518717885,
      "rmse_mean": 0.009431040845811367,
      "rotation_flip": 0.0014423077227547765,
      "sparse_tokens": 32121.0,
      "step": 4099,
      "turn_loss": 0.05588839575648308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19048503995539862,
      "grad_norm": 0.4419868588447571,
      "learning_rate": 7.478212103683336e-06,
      "loss": 0.0885,
      "mae_dtheta": 0.011513865552842617,
      "mae_dx": 0.0016189994057640433,
      "mae_dy": 0.002459984738379717,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4419868588447571,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 145.85569763183594,
      "model/head/act_norm_mean": 113.1444424715909,
      "model/head/act_norm_min": 70.65190124511719,
      "model/head/act_over_embed": 77.75392014143684,
      "model/head/grad_frac": 0.11344369500875473,
      "model/head/grad_norm": 0.0501406230032444,
      "model/head/grad_zero_frac": 0.00012468780914787203,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6937144886363636,
      "model/head/update_ratio": 0.00086137221660465,
      "model/head/weight_delta": 7.556260585784912,
      "model/head/weight_delta_rel": 0.13255919516086578,
      "model/head/weight_norm": 58.21017074584961,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4178202450275421,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4177556743536295,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4176827073097229,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2870856105060577,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08053293824195862,
      "model/modality_embedder.encoders.pose/grad_norm": 0.035594500601291656,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5427848234304933,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011527554597705603,
      "model/modality_embedder.encoders.pose/weight_delta": 2.4775984287261963,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08095086365938187,
      "model/modality_embedder.encoders.pose/weight_norm": 30.87775421142578,
      "model/modality_embedder/grad_frac": 0.08053293824195862,
      "model/modality_embedder/grad_norm": 0.035594500601291656,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5427848234304933,
      "model/modality_embedder/update_ratio": 0.0011527554597705603,
      "model/modality_embedder/weight_delta": 2.4775984287261963,
      "model/modality_embedder/weight_delta_rel": 0.08095086365938187,
      "model/modality_embedder/weight_norm": 30.87775421142578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.45545959472656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.85413159371493,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.004453659057617,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.392782557099437,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0971810445189476,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04295274615287781,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015476057305932045,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.7801084518432617,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06486822664737701,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.75432014465332,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.96110534667969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.8961690315857,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.36824893951416,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.108880440112426,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09568279981613159,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04229053854942322,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014370764838531613,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.251000165939331,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07797640562057495,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.42817497253418,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.23306274414062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.77652016193683,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.658834457397461,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.401075341014362,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0961494892835617,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04249681159853935,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013987831771373749,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.4159834384918213,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0811242014169693,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.381271362304688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.97804260253906,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.581697430655765,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.192350387573242,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.641610060413875,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10045154392719269,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04439826309680939,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014953739009797573,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.062664270401001,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07049207389354706,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.69040870666504,
      "model/normalizer/grad_frac": 0.37233009934425354,
      "model/normalizer/grad_norm": 0.16456501185894012,
      "model/normalizer/grad_zero_frac": 0.0001347181823803112,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021023994777351618,
      "model/normalizer/weight_delta": 4.381167411804199,
      "model/normalizer/weight_delta_rel": 0.05642690137028694,
      "model/normalizer/weight_norm": 78.27485656738281,
      "pose_mae_dtheta": 0.07081353664398193,
      "pose_mae_dx": 0.02319514937698841,
      "pose_mae_dy": 0.03099483996629715,
      "pose_rmse_dtheta": 0.13519661128520966,
      "pose_rmse_dx": 0.05230493098497391,
      "pose_rmse_dy": 0.06452174484729767,
      "pose_rmse_mean": 0.08400776237249374,
      "rmse_dtheta": 0.021480215713381767,
      "rmse_dx": 0.004529118072241545,
      "rmse_dy": 0.004703905899077654,
      "rmse_mean": 0.010237746872007847,
      "rotation_flip": 0.003800967475399375,
      "sparse_tokens": 32105.0,
      "step": 4100,
      "turn_loss": 0.08672990649938583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.1905314997212414,
      "grad_norm": 0.5625085830688477,
      "learning_rate": 7.477063634456263e-06,
      "loss": 0.1386,
      "mae_dtheta": 0.038411930203437805,
      "mae_dx": 0.006629439070820808,
      "mae_dy": 0.0017018669750541449,
      "pose_mae_dtheta": 0.29152238368988037,
      "pose_mae_dx": 0.03857690840959549,
      "pose_mae_dy": 0.02042897790670395,
      "pose_rmse_dtheta": 0.5630788803100586,
      "pose_rmse_dx": 0.10956361144781113,
      "pose_rmse_dy": 0.061567723751068115,
      "pose_rmse_mean": 0.24473673105239868,
      "rmse_dtheta": 0.058558885008096695,
      "rmse_dx": 0.01661115139722824,
      "rmse_dy": 0.004136714152991772,
      "rmse_mean": 0.02643558382987976,
      "rotation_flip": 0.008012820966541767,
      "sparse_tokens": 9352.0,
      "step": 4101,
      "turn_loss": 0.1777849793434143,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1905779594870842,
      "grad_norm": 0.5169258117675781,
      "learning_rate": 7.475914992006798e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.01102203968912363,
      "mae_dx": 0.0017394180176779628,
      "mae_dy": 0.002205893164500594,
      "pose_mae_dtheta": 0.08238384872674942,
      "pose_mae_dx": 0.024213269352912903,
      "pose_mae_dy": 0.03310467302799225,
      "pose_rmse_dtheta": 0.1922459900379181,
      "pose_rmse_dx": 0.07102743536233902,
      "pose_rmse_dy": 0.07691850513219833,
      "pose_rmse_mean": 0.11339731514453888,
      "rmse_dtheta": 0.02282104641199112,
      "rmse_dx": 0.006630235351622105,
      "rmse_dy": 0.004951047711074352,
      "rmse_mean": 0.011467443779110909,
      "rotation_flip": 0.001616814872249961,
      "sparse_tokens": 32057.0,
      "step": 4102,
      "turn_loss": 0.08392585068941116,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19062441925292697,
      "grad_norm": 0.554976761341095,
      "learning_rate": 7.4747661764152716e-06,
      "loss": 0.1383,
      "mae_dtheta": 0.011672991327941418,
      "mae_dx": 0.0016244248254224658,
      "mae_dy": 0.0025394882541149855,
      "pose_mae_dtheta": 0.08168110251426697,
      "pose_mae_dx": 0.023493612185120583,
      "pose_mae_dy": 0.038240376859903336,
      "pose_rmse_dtheta": 0.15926317870616913,
      "pose_rmse_dx": 0.05900556594133377,
      "pose_rmse_dy": 0.09091313183307648,
      "pose_rmse_mean": 0.10306062549352646,
      "rmse_dtheta": 0.020785685628652573,
      "rmse_dx": 0.0052879685536026955,
      "rmse_dy": 0.0052708848379552364,
      "rmse_mean": 0.010448179207742214,
      "rotation_flip": 0.005728607065975666,
      "sparse_tokens": 32089.0,
      "step": 4103,
      "turn_loss": 0.08506088703870773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.19067087901876975,
      "grad_norm": 0.48565274477005005,
      "learning_rate": 7.473617187762017e-06,
      "loss": 0.1167,
      "mae_dtheta": 0.013432258740067482,
      "mae_dx": 0.003512487979605794,
      "mae_dy": 0.0036404880229383707,
      "pose_mae_dtheta": 0.09396222978830338,
      "pose_mae_dx": 0.03966069966554642,
      "pose_mae_dy": 0.038584496825933456,
      "pose_rmse_dtheta": 0.19977343082427979,
      "pose_rmse_dx": 0.11306148767471313,
      "pose_rmse_dy": 0.08372826129198074,
      "pose_rmse_mean": 0.13218772411346436,
      "rmse_dtheta": 0.025744836777448654,
      "rmse_dx": 0.010925075970590115,
      "rmse_dy": 0.008222437463700771,
      "rmse_mean": 0.014964117668569088,
      "rotation_flip": 0.0032271076925098896,
      "sparse_tokens": 32057.0,
      "step": 4104,
      "turn_loss": 0.14081726968288422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.19071733878461253,
      "grad_norm": 0.5379745364189148,
      "learning_rate": 7.472468026127385e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.012082649394869804,
      "mae_dx": 0.0022791263181716204,
      "mae_dy": 0.0024850741028785706,
      "pose_mae_dtheta": 0.07938375324010849,
      "pose_mae_dx": 0.027789253741502762,
      "pose_mae_dy": 0.030053872615098953,
      "pose_rmse_dtheta": 0.19905003905296326,
      "pose_rmse_dx": 0.05485781654715538,
      "pose_rmse_dy": 0.06512469798326492,
      "pose_rmse_mean": 0.10634418576955795,
      "rmse_dtheta": 0.02502257376909256,
      "rmse_dx": 0.005949128419160843,
      "rmse_dy": 0.005007070954889059,
      "rmse_mean": 0.0119929239153862,
      "rotation_flip": 0.006335128098726273,
      "sparse_tokens": 32217.0,
      "step": 4105,
      "turn_loss": 0.09185735136270523,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18452.0,
      "epoch": 0.1907637985504553,
      "grad_norm": 0.5033793449401855,
      "learning_rate": 7.4713186915917365e-06,
      "loss": 0.1142,
      "mae_dtheta": 0.034946244210004807,
      "mae_dx": 0.011300700716674328,
      "mae_dy": 0.0032733669504523277,
      "pose_mae_dtheta": 0.2780246138572693,
      "pose_mae_dx": 0.09740126132965088,
      "pose_mae_dy": 0.027796396985650063,
      "pose_rmse_dtheta": 0.5148516893386841,
      "pose_rmse_dx": 0.21320953965187073,
      "pose_rmse_dy": 0.06201719492673874,
      "pose_rmse_mean": 0.2633594870567322,
      "rmse_dtheta": 0.0544789656996727,
      "rmse_dx": 0.022915424779057503,
      "rmse_dy": 0.006732155103236437,
      "rmse_mean": 0.028042182326316833,
      "rotation_flip": 0.01860465109348297,
      "sparse_tokens": 14746.0,
      "step": 4106,
      "turn_loss": 0.24633120000362396,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.19081025831629808,
      "grad_norm": 0.49189963936805725,
      "learning_rate": 7.4701691842354465e-06,
      "loss": 0.1587,
      "mae_dtheta": 0.024677002802491188,
      "mae_dx": 0.009573288261890411,
      "mae_dy": 0.003324743127450347,
      "pose_mae_dtheta": 0.19105762243270874,
      "pose_mae_dx": 0.08116327971220016,
      "pose_mae_dy": 0.03813064098358154,
      "pose_rmse_dtheta": 0.3411456048488617,
      "pose_rmse_dx": 0.1790495365858078,
      "pose_rmse_dy": 0.10857672244310379,
      "pose_rmse_mean": 0.2095906138420105,
      "rmse_dtheta": 0.041007742285728455,
      "rmse_dx": 0.021557865664362907,
      "rmse_dy": 0.007495423313230276,
      "rmse_mean": 0.023353679105639458,
      "rotation_flip": 0.012965964153409004,
      "sparse_tokens": 10272.0,
      "step": 4107,
      "turn_loss": 0.2046704739332199,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19085671808214086,
      "grad_norm": 0.4986219108104706,
      "learning_rate": 7.469019504138898e-06,
      "loss": 0.0886,
      "mae_dtheta": 0.011877845041453838,
      "mae_dx": 0.002422452438622713,
      "mae_dy": 0.0027770292945206165,
      "pose_mae_dtheta": 0.0787789598107338,
      "pose_mae_dx": 0.027124330401420593,
      "pose_mae_dy": 0.03435710072517395,
      "pose_rmse_dtheta": 0.17136014997959137,
      "pose_rmse_dx": 0.06096801534295082,
      "pose_rmse_dy": 0.07857116311788559,
      "pose_rmse_mean": 0.1036331057548523,
      "rmse_dtheta": 0.0241257157176733,
      "rmse_dx": 0.006806567776948214,
      "rmse_dy": 0.0065389834344387054,
      "rmse_mean": 0.012490421533584595,
      "rotation_flip": 0.007398753892630339,
      "sparse_tokens": 32105.0,
      "step": 4108,
      "turn_loss": 0.10071425884962082,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.19090317784798363,
      "grad_norm": 0.7585108280181885,
      "learning_rate": 7.467869651382491e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.017256906256079674,
      "mae_dx": 0.0030150599777698517,
      "mae_dy": 0.005144483409821987,
      "pose_mae_dtheta": 0.12269099801778793,
      "pose_mae_dx": 0.04842676222324371,
      "pose_mae_dy": 0.05864245817065239,
      "pose_rmse_dtheta": 0.2589559257030487,
      "pose_rmse_dx": 0.11617075651884079,
      "pose_rmse_dy": 0.1300564557313919,
      "pose_rmse_mean": 0.16839438676834106,
      "rmse_dtheta": 0.03132756054401398,
      "rmse_dx": 0.0072943721897900105,
      "rmse_dy": 0.010442844592034817,
      "rmse_mean": 0.01635492593050003,
      "rotation_flip": 0.0074028377421200275,
      "sparse_tokens": 32121.0,
      "step": 4109,
      "turn_loss": 0.1445426493883133,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19094963761382644,
      "grad_norm": 0.5208114981651306,
      "learning_rate": 7.466719626046636e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.014784547500312328,
      "mae_dx": 0.0023434467148035765,
      "mae_dy": 0.004022044595330954,
      "pose_mae_dtheta": 0.09685909748077393,
      "pose_mae_dx": 0.02695883996784687,
      "pose_mae_dy": 0.046473436057567596,
      "pose_rmse_dtheta": 0.17790621519088745,
      "pose_rmse_dx": 0.06326605379581451,
      "pose_rmse_dy": 0.09796486049890518,
      "pose_rmse_mean": 0.11304571479558945,
      "rmse_dtheta": 0.025922564789652824,
      "rmse_dx": 0.0069985114969313145,
      "rmse_dy": 0.008554783649742603,
      "rmse_mean": 0.01382528617978096,
      "rotation_flip": 0.0037747719325125217,
      "sparse_tokens": 32105.0,
      "step": 4110,
      "turn_loss": 0.13970811665058136,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.19099609737966922,
      "grad_norm": 0.6314625144004822,
      "learning_rate": 7.465569428211752e-06,
      "loss": 0.1084,
      "mae_dtheta": 0.007822023704648018,
      "mae_dx": 0.0018528159707784653,
      "mae_dy": 0.001515295123681426,
      "pose_mae_dtheta": 0.05675777420401573,
      "pose_mae_dx": 0.020574035122990608,
      "pose_mae_dy": 0.01886189542710781,
      "pose_rmse_dtheta": 0.14591075479984283,
      "pose_rmse_dx": 0.04746231809258461,
      "pose_rmse_dy": 0.04749308153986931,
      "pose_rmse_mean": 0.08028872311115265,
      "rmse_dtheta": 0.018727675080299377,
      "rmse_dx": 0.0051988898776471615,
      "rmse_dy": 0.0036988044157624245,
      "rmse_mean": 0.009208457544445992,
      "rotation_flip": 0.0021352313924580812,
      "sparse_tokens": 32201.0,
      "step": 4111,
      "turn_loss": 0.0650009959936142,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.191042557145512,
      "grad_norm": 0.5268806219100952,
      "learning_rate": 7.4644190579582755e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.007389571983367205,
      "mae_dx": 0.0015624839579686522,
      "mae_dy": 0.0008634250843897462,
      "pose_mae_dtheta": 0.055220406502485275,
      "pose_mae_dx": 0.01772625558078289,
      "pose_mae_dy": 0.014684629626572132,
      "pose_rmse_dtheta": 0.19348137080669403,
      "pose_rmse_dx": 0.04432906582951546,
      "pose_rmse_dy": 0.04240722581744194,
      "pose_rmse_mean": 0.09340588748455048,
      "rmse_dtheta": 0.022571465000510216,
      "rmse_dx": 0.005112685263156891,
      "rmse_dy": 0.0023736250586807728,
      "rmse_mean": 0.010019258596003056,
      "rotation_flip": 0.0011123470030725002,
      "sparse_tokens": 32121.0,
      "step": 4112,
      "turn_loss": 0.058678921312093735,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.19108901691135477,
      "grad_norm": 0.9053553938865662,
      "learning_rate": 7.4632685153666505e-06,
      "loss": 0.2778,
      "mae_dtheta": 0.022458720952272415,
      "mae_dx": 0.0025992393493652344,
      "mae_dy": 0.005146189592778683,
      "pose_mae_dtheta": 0.18165314197540283,
      "pose_mae_dx": 0.03249215707182884,
      "pose_mae_dy": 0.06801170855760574,
      "pose_rmse_dtheta": 0.3184785544872284,
      "pose_rmse_dx": 0.07030215114355087,
      "pose_rmse_dy": 0.13183002173900604,
      "pose_rmse_mean": 0.17353692650794983,
      "rmse_dtheta": 0.0385504849255085,
      "rmse_dx": 0.007690952625125647,
      "rmse_dy": 0.009249803610146046,
      "rmse_mean": 0.018497079610824585,
      "rotation_flip": 0.008097166195511818,
      "sparse_tokens": 4388.0,
      "step": 4113,
      "turn_loss": 0.16156527400016785,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.19113547667719755,
      "grad_norm": 0.7490986585617065,
      "learning_rate": 7.462117800517337e-06,
      "loss": 0.1697,
      "mae_dtheta": 0.03837261348962784,
      "mae_dx": 0.01606612280011177,
      "mae_dy": 0.018912827596068382,
      "pose_mae_dtheta": 0.36002764105796814,
      "pose_mae_dx": 0.16473612189292908,
      "pose_mae_dy": 0.1507067233324051,
      "pose_rmse_dtheta": 0.5822969079017639,
      "pose_rmse_dx": 0.3132242262363434,
      "pose_rmse_dy": 0.29365023970603943,
      "pose_rmse_mean": 0.39639049768447876,
      "rmse_dtheta": 0.05768541619181633,
      "rmse_dx": 0.029405852779746056,
      "rmse_dy": 0.03225124627351761,
      "rmse_mean": 0.039780840277671814,
      "rotation_flip": 0.012195121496915817,
      "sparse_tokens": 6328.0,
      "step": 4114,
      "turn_loss": 0.4853914976119995,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 8760.0,
      "epoch": 0.19118193644304032,
      "grad_norm": 0.7318811416625977,
      "learning_rate": 7.460966913490804e-06,
      "loss": 0.1149,
      "mae_dtheta": 0.0415184386074543,
      "mae_dx": 0.008340203203260899,
      "mae_dy": 0.004572245292365551,
      "pose_mae_dtheta": 0.33336880803108215,
      "pose_mae_dx": 0.054229702800512314,
      "pose_mae_dy": 0.046739596873521805,
      "pose_rmse_dtheta": 0.6066681146621704,
      "pose_rmse_dx": 0.1295812726020813,
      "pose_rmse_dy": 0.1671091914176941,
      "pose_rmse_mean": 0.30111953616142273,
      "rmse_dtheta": 0.06391306966543198,
      "rmse_dx": 0.018642669543623924,
      "rmse_dy": 0.011813253164291382,
      "rmse_mean": 0.03145633265376091,
      "rotation_flip": 0.009569377638399601,
      "sparse_tokens": 7402.0,
      "step": 4115,
      "turn_loss": 0.3521166145801544,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1912283962088831,
      "grad_norm": 0.6480321288108826,
      "learning_rate": 7.459815854367533e-06,
      "loss": 0.1719,
      "mae_dtheta": 0.01435854472219944,
      "mae_dx": 0.0030514593236148357,
      "mae_dy": 0.0035368117969483137,
      "pose_mae_dtheta": 0.10064410418272018,
      "pose_mae_dx": 0.03751157596707344,
      "pose_mae_dy": 0.03622080758213997,
      "pose_rmse_dtheta": 0.2599385678768158,
      "pose_rmse_dx": 0.1159970760345459,
      "pose_rmse_dy": 0.09940502047538757,
      "pose_rmse_mean": 0.15844689309597015,
      "rmse_dtheta": 0.031134117394685745,
      "rmse_dx": 0.008178625255823135,
      "rmse_dy": 0.009339532814919949,
      "rmse_mean": 0.0162174254655838,
      "rotation_flip": 0.0061773257330060005,
      "sparse_tokens": 32121.0,
      "step": 4116,
      "turn_loss": 0.13193954527378082,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19127485597472588,
      "grad_norm": 0.5692747235298157,
      "learning_rate": 7.45866462322802e-06,
      "loss": 0.1351,
      "mae_dtheta": 0.013058295473456383,
      "mae_dx": 0.002335723489522934,
      "mae_dy": 0.003237859345972538,
      "pose_mae_dtheta": 0.08600113540887833,
      "pose_mae_dx": 0.029810944572091103,
      "pose_mae_dy": 0.03880763798952103,
      "pose_rmse_dtheta": 0.1823544055223465,
      "pose_rmse_dx": 0.08791190385818481,
      "pose_rmse_dy": 0.08808483183383942,
      "pose_rmse_mean": 0.11945037543773651,
      "rmse_dtheta": 0.024504102766513824,
      "rmse_dx": 0.0071282279677689075,
      "rmse_dy": 0.007527850568294525,
      "rmse_mean": 0.013053393922746181,
      "rotation_flip": 0.006132618058472872,
      "sparse_tokens": 32089.0,
      "step": 4117,
      "turn_loss": 0.09368538111448288,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.19132131574056865,
      "grad_norm": 0.9509643316268921,
      "learning_rate": 7.45751322015277e-06,
      "loss": 0.3076,
      "mae_dtheta": 0.036081064492464066,
      "mae_dx": 0.00588288763538003,
      "mae_dy": 0.005363293923437595,
      "pose_mae_dtheta": 0.24213850498199463,
      "pose_mae_dx": 0.0611632764339447,
      "pose_mae_dy": 0.05719786509871483,
      "pose_rmse_dtheta": 0.4595325291156769,
      "pose_rmse_dx": 0.17947779595851898,
      "pose_rmse_dy": 0.1291767656803131,
      "pose_rmse_mean": 0.2560623586177826,
      "rmse_dtheta": 0.055023323744535446,
      "rmse_dx": 0.01697336509823799,
      "rmse_dy": 0.010453877039253712,
      "rmse_mean": 0.02748352289199829,
      "rotation_flip": 0.013667426072061062,
      "sparse_tokens": 6683.0,
      "step": 4118,
      "turn_loss": 0.28308260440826416,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.19136777550641146,
      "grad_norm": 0.6476282477378845,
      "learning_rate": 7.456361645222301e-06,
      "loss": 0.1064,
      "mae_dtheta": 0.02869088016450405,
      "mae_dx": 0.011080250144004822,
      "mae_dy": 0.0047653247602283955,
      "pose_mae_dtheta": 0.20134992897510529,
      "pose_mae_dx": 0.10069403052330017,
      "pose_mae_dy": 0.06631166487932205,
      "pose_rmse_dtheta": 0.36920106410980225,
      "pose_rmse_dx": 0.23589375615119934,
      "pose_rmse_dy": 0.1351897418498993,
      "pose_rmse_mean": 0.2467615306377411,
      "rmse_dtheta": 0.044806357473134995,
      "rmse_dx": 0.02495190128684044,
      "rmse_dy": 0.00898212380707264,
      "rmse_mean": 0.026246793568134308,
      "rotation_flip": 0.010830325074493885,
      "sparse_tokens": 10230.0,
      "step": 4119,
      "turn_loss": 0.22454272210597992,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.19141423527225424,
      "grad_norm": 0.4269867241382599,
      "learning_rate": 7.455209898517145e-06,
      "loss": 0.0752,
      "mae_dtheta": 0.009878984652459621,
      "mae_dx": 0.0022191780153661966,
      "mae_dy": 0.0005382278468459845,
      "pose_mae_dtheta": 0.07100220769643784,
      "pose_mae_dx": 0.016678890213370323,
      "pose_mae_dy": 0.0061821648851037025,
      "pose_rmse_dtheta": 0.2694668471813202,
      "pose_rmse_dx": 0.035250913351774216,
      "pose_rmse_dy": 0.014536487869918346,
      "pose_rmse_mean": 0.10641808807849884,
      "rmse_dtheta": 0.031581342220306396,
      "rmse_dx": 0.0055769351311028,
      "rmse_dy": 0.0013672808418050408,
      "rmse_mean": 0.012841853313148022,
      "rotation_flip": 0.0018507094355300069,
      "sparse_tokens": 32201.0,
      "step": 4120,
      "turn_loss": 0.06679292768239975,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.191460695038097,
      "grad_norm": 0.42405498027801514,
      "learning_rate": 7.454057980117842e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.009766146540641785,
      "mae_dx": 0.0028950369451195,
      "mae_dy": 0.0026769828982651234,
      "pose_mae_dtheta": 0.06574239581823349,
      "pose_mae_dx": 0.029998797923326492,
      "pose_mae_dy": 0.02805151231586933,
      "pose_rmse_dtheta": 0.1561855673789978,
      "pose_rmse_dx": 0.07811987400054932,
      "pose_rmse_dy": 0.06473519653081894,
      "pose_rmse_mean": 0.09968021512031555,
      "rmse_dtheta": 0.021259572356939316,
      "rmse_dx": 0.009255698882043362,
      "rmse_dy": 0.006370991934090853,
      "rmse_mean": 0.012295421212911606,
      "rotation_flip": 0.00805305503308773,
      "sparse_tokens": 32073.0,
      "step": 4121,
      "turn_loss": 0.09624835848808289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.1915071548039398,
      "grad_norm": 0.7007705569267273,
      "learning_rate": 7.452905890104947e-06,
      "loss": 0.1761,
      "mae_dtheta": 0.037627607583999634,
      "mae_dx": 0.014496020041406155,
      "mae_dy": 0.008027268573641777,
      "pose_mae_dtheta": 0.32586976885795593,
      "pose_mae_dx": 0.1290888786315918,
      "pose_mae_dy": 0.08546222746372223,
      "pose_rmse_dtheta": 0.5051518678665161,
      "pose_rmse_dx": 0.26547420024871826,
      "pose_rmse_dy": 0.17589730024337769,
      "pose_rmse_mean": 0.31550779938697815,
      "rmse_dtheta": 0.0530993677675724,
      "rmse_dx": 0.026963328942656517,
      "rmse_dy": 0.01644158735871315,
      "rmse_mean": 0.03216809779405594,
      "rotation_flip": 0.01923076994717121,
      "sparse_tokens": 12178.0,
      "step": 4122,
      "turn_loss": 0.33693748712539673,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19155361456978257,
      "grad_norm": 0.4307839572429657,
      "learning_rate": 7.451753628559027e-06,
      "loss": 0.0624,
      "mae_dtheta": 0.010465570725500584,
      "mae_dx": 0.0017199128633365035,
      "mae_dy": 0.0019744893070310354,
      "pose_mae_dtheta": 0.07032763212919235,
      "pose_mae_dx": 0.01736806333065033,
      "pose_mae_dy": 0.024035977199673653,
      "pose_rmse_dtheta": 0.17519325017929077,
      "pose_rmse_dx": 0.04838920757174492,
      "pose_rmse_dy": 0.056614380329847336,
      "pose_rmse_mean": 0.09339895099401474,
      "rmse_dtheta": 0.02457364648580551,
      "rmse_dx": 0.006118051707744598,
      "rmse_dy": 0.005940732546150684,
      "rmse_mean": 0.01221081055700779,
      "rotation_flip": 0.0022341376170516014,
      "sparse_tokens": 32089.0,
      "step": 4123,
      "turn_loss": 0.07439502328634262,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.19160007433562534,
      "grad_norm": 0.7253668308258057,
      "learning_rate": 7.450601195560659e-06,
      "loss": 0.2363,
      "mae_dtheta": 0.04444421827793121,
      "mae_dx": 0.01150756236165762,
      "mae_dy": 0.003931879531592131,
      "pose_mae_dtheta": 0.3877149522304535,
      "pose_mae_dx": 0.0926518514752388,
      "pose_mae_dy": 0.0473613515496254,
      "pose_rmse_dtheta": 0.5975494980812073,
      "pose_rmse_dx": 0.19368933141231537,
      "pose_rmse_dy": 0.1343831717967987,
      "pose_rmse_mean": 0.3085406720638275,
      "rmse_dtheta": 0.06057589128613472,
      "rmse_dx": 0.022650303319096565,
      "rmse_dy": 0.009571452625095844,
      "rmse_mean": 0.030932551249861717,
      "rotation_flip": 0.013313609175384045,
      "sparse_tokens": 11051.0,
      "step": 4124,
      "turn_loss": 0.29944172501564026,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.19164653410146812,
      "grad_norm": 0.7357335090637207,
      "learning_rate": 7.449448591190436e-06,
      "loss": 0.2149,
      "mae_dtheta": 0.029699519276618958,
      "mae_dx": 0.010608287528157234,
      "mae_dy": 0.00602274714037776,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7357333898544312,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.43154907226562,
      "model/head/act_norm_mean": 119.41731770833333,
      "model/head/act_norm_min": 65.14286804199219,
      "model/head/act_over_embed": 82.06469873170947,
      "model/head/grad_frac": 0.08908000588417053,
      "model/head/grad_norm": 0.06553913652896881,
      "model/head/grad_zero_frac": 0.00021193754218984395,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.69703125,
      "model/head/update_ratio": 0.001125807291828096,
      "model/head/weight_delta": 7.578800678253174,
      "model/head/weight_delta_rel": 0.13295461237430573,
      "model/head/weight_norm": 58.215232849121094,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.417965829372406,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.417965829372406,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.417965829372406,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28723003100246325,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09323740005493164,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06859786808490753,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0022214832715690136,
      "model/modality_embedder.encoders.pose/weight_delta": 2.4860727787017822,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08122774958610535,
      "model/modality_embedder.encoders.pose/weight_norm": 30.879308700561523,
      "model/modality_embedder/grad_frac": 0.09323740005493164,
      "model/modality_embedder/grad_norm": 0.06859786808490753,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0022214832715690136,
      "model/modality_embedder/weight_delta": 2.4860727787017822,
      "model/modality_embedder/weight_delta_rel": 0.08122774958610535,
      "model/modality_embedder/weight_norm": 30.879308700561523,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.66307067871094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.428060515873018,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.077120780944824,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.7871918856137,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05547726899385452,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04081647843122482,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001470552640967071,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.7878854274749756,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0651516243815422,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.755876541137695,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.05464935302734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.253940145502646,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.769103050231934,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.354744099102092,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05962831526994705,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04387054219841957,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014906011056154966,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.2609286308288574,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07832033187150955,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.43144416809082,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.73356628417969,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.905373677248676,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.824538230895996,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.48962468308228,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.059411413967609406,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04371096193790436,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001438641338609159,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.4259192943573,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08145783096551895,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.383502960205078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.59307861328125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.84130291005291,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.803827285766602,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.820013376320382,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.056805845350027084,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.041793957352638245,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014075962826609612,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.071455955505371,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0707925334572792,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.691720962524414,
      "model/normalizer/grad_frac": 0.19236035645008087,
      "model/normalizer/grad_norm": 0.14152593910694122,
      "model/normalizer/grad_zero_frac": 0.0002410746383247897,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018080027075484395,
      "model/normalizer/weight_delta": 4.399911880493164,
      "model/normalizer/weight_delta_rel": 0.056668318808078766,
      "model/normalizer/weight_norm": 78.27750396728516,
      "pose_mae_dtheta": 0.2328009158372879,
      "pose_mae_dx": 0.09799650311470032,
      "pose_mae_dy": 0.08971091359853745,
      "pose_rmse_dtheta": 0.4247003197669983,
      "pose_rmse_dx": 0.2158242017030716,
      "pose_rmse_dy": 0.19059206545352936,
      "pose_rmse_mean": 0.2770388722419739,
      "rmse_dtheta": 0.04785565286874771,
      "rmse_dx": 0.02308519557118416,
      "rmse_dy": 0.01321959774941206,
      "rmse_mean": 0.028053482994437218,
      "rotation_flip": 0.01011122390627861,
      "sparse_tokens": 19459.0,
      "step": 4125,
      "turn_loss": 0.22339701652526855,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1916929938673109,
      "grad_norm": 0.5936395525932312,
      "learning_rate": 7.448295815528956e-06,
      "loss": 0.1475,
      "mae_dtheta": 0.007948270998895168,
      "mae_dx": 0.0014860267983749509,
      "mae_dy": 0.0019130194559693336,
      "pose_mae_dtheta": 0.05400679633021355,
      "pose_mae_dx": 0.017960727214813232,
      "pose_mae_dy": 0.021291926503181458,
      "pose_rmse_dtheta": 0.12228324264287949,
      "pose_rmse_dx": 0.05278007686138153,
      "pose_rmse_dy": 0.0531872920691967,
      "pose_rmse_mean": 0.07608354091644287,
      "rmse_dtheta": 0.017733797430992126,
      "rmse_dx": 0.005152929574251175,
      "rmse_dy": 0.0049485331401228905,
      "rmse_mean": 0.009278420358896255,
      "rotation_flip": 0.006354970391839743,
      "sparse_tokens": 32057.0,
      "step": 4126,
      "turn_loss": 0.06922449916601181,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20711.0,
      "epoch": 0.1917394536331537,
      "grad_norm": 0.5557038187980652,
      "learning_rate": 7.447142868656838e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.0326056145131588,
      "mae_dx": 0.014342211186885834,
      "mae_dy": 0.003291108412668109,
      "pose_mae_dtheta": 0.27170100808143616,
      "pose_mae_dx": 0.11756736040115356,
      "pose_mae_dy": 0.05477438122034073,
      "pose_rmse_dtheta": 0.5042812824249268,
      "pose_rmse_dx": 0.2669319808483124,
      "pose_rmse_dy": 0.13573133945465088,
      "pose_rmse_mean": 0.3023148775100708,
      "rmse_dtheta": 0.05078473314642906,
      "rmse_dx": 0.02871367149055004,
      "rmse_dy": 0.006525131408125162,
      "rmse_mean": 0.02867451123893261,
      "rotation_flip": 0.009501188062131405,
      "sparse_tokens": 15949.0,
      "step": 4127,
      "turn_loss": 0.269885778427124,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 26848.0,
      "epoch": 0.19178591339899648,
      "grad_norm": 0.7311904430389404,
      "learning_rate": 7.4459897506547055e-06,
      "loss": 0.1812,
      "mae_dtheta": 0.03760186955332756,
      "mae_dx": 0.011692523956298828,
      "mae_dy": 0.009715739637613297,
      "pose_mae_dtheta": 0.3026929199695587,
      "pose_mae_dx": 0.10242078453302383,
      "pose_mae_dy": 0.12607669830322266,
      "pose_rmse_dtheta": 0.5252518057823181,
      "pose_rmse_dx": 0.21493683755397797,
      "pose_rmse_dy": 0.3003695011138916,
      "pose_rmse_mean": 0.34685271978378296,
      "rmse_dtheta": 0.054769158363342285,
      "rmse_dx": 0.02313048765063286,
      "rmse_dy": 0.02014995738863945,
      "rmse_mean": 0.03268320485949516,
      "rotation_flip": 0.014878621324896812,
      "sparse_tokens": 21087.0,
      "step": 4128,
      "turn_loss": 0.3326931595802307,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.19183237316483925,
      "grad_norm": 0.6654199361801147,
      "learning_rate": 7.444836461603195e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.009610030800104141,
      "mae_dx": 0.0019382935715839267,
      "mae_dy": 0.0010388484224677086,
      "pose_mae_dtheta": 0.07188546657562256,
      "pose_mae_dx": 0.018527785316109657,
      "pose_mae_dy": 0.01962205395102501,
      "pose_rmse_dtheta": 0.2057109773159027,
      "pose_rmse_dx": 0.04715519770979881,
      "pose_rmse_dy": 0.05696224421262741,
      "pose_rmse_mean": 0.10327614843845367,
      "rmse_dtheta": 0.025891849771142006,
      "rmse_dx": 0.005797193385660648,
      "rmse_dy": 0.0025420442689210176,
      "rmse_mean": 0.011410363018512726,
      "rotation_flip": 0.002207505516707897,
      "sparse_tokens": 32137.0,
      "step": 4129,
      "turn_loss": 0.068620964884758,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.19187883293068203,
      "grad_norm": 0.5058371424674988,
      "learning_rate": 7.4436830015829595e-06,
      "loss": 0.1417,
      "mae_dtheta": 0.03521175682544708,
      "mae_dx": 0.012250439263880253,
      "mae_dy": 0.004112048074603081,
      "pose_mae_dtheta": 0.27641886472702026,
      "pose_mae_dx": 0.09576228260993958,
      "pose_mae_dy": 0.05404991656541824,
      "pose_rmse_dtheta": 0.5093502402305603,
      "pose_rmse_dx": 0.19285279512405396,
      "pose_rmse_dy": 0.1516471654176712,
      "pose_rmse_mean": 0.28461673855781555,
      "rmse_dtheta": 0.0554061196744442,
      "rmse_dx": 0.024111874401569366,
      "rmse_dy": 0.010580848902463913,
      "rmse_mean": 0.030032947659492493,
      "rotation_flip": 0.014519056305289268,
      "sparse_tokens": 11283.0,
      "step": 4130,
      "turn_loss": 0.24112296104431152,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.1919252926965248,
      "grad_norm": 0.6425475478172302,
      "learning_rate": 7.442529370674661e-06,
      "loss": 0.1648,
      "mae_dtheta": 0.047653425484895706,
      "mae_dx": 0.012328054755926132,
      "mae_dy": 0.008227829821407795,
      "pose_mae_dtheta": 0.3729439973831177,
      "pose_mae_dx": 0.10338204354047775,
      "pose_mae_dy": 0.06776972860097885,
      "pose_rmse_dtheta": 0.6078327298164368,
      "pose_rmse_dx": 0.21576088666915894,
      "pose_rmse_dy": 0.21475552022457123,
      "pose_rmse_mean": 0.34611639380455017,
      "rmse_dtheta": 0.06837457418441772,
      "rmse_dx": 0.022592125460505486,
      "rmse_dy": 0.018706995993852615,
      "rmse_mean": 0.03655789792537689,
      "rotation_flip": 0.014681892469525337,
      "sparse_tokens": 9718.0,
      "step": 4131,
      "turn_loss": 0.3149205446243286,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 11667.0,
      "epoch": 0.19197175246236758,
      "grad_norm": 0.7673670649528503,
      "learning_rate": 7.441375568958971e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.026224683970212936,
      "mae_dx": 0.010921546258032322,
      "mae_dy": 0.003072966355830431,
      "pose_mae_dtheta": 0.17920386791229248,
      "pose_mae_dx": 0.0888553112745285,
      "pose_mae_dy": 0.0497431606054306,
      "pose_rmse_dtheta": 0.341824471950531,
      "pose_rmse_dx": 0.24363954365253448,
      "pose_rmse_dy": 0.11526496708393097,
      "pose_rmse_mean": 0.23357632756233215,
      "rmse_dtheta": 0.042435452342033386,
      "rmse_dx": 0.025376953184604645,
      "rmse_dy": 0.005628054030239582,
      "rmse_mean": 0.024480154737830162,
      "rotation_flip": 0.01440329197794199,
      "sparse_tokens": 10108.0,
      "step": 4132,
      "turn_loss": 0.2074298858642578,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 31369.0,
      "epoch": 0.19201821222821036,
      "grad_norm": 0.5549744367599487,
      "learning_rate": 7.440221596516578e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.034428730607032776,
      "mae_dx": 0.014260134659707546,
      "mae_dy": 0.0057206591591238976,
      "pose_mae_dtheta": 0.2857125699520111,
      "pose_mae_dx": 0.12264294922351837,
      "pose_mae_dy": 0.06592679023742676,
      "pose_rmse_dtheta": 0.49720168113708496,
      "pose_rmse_dx": 0.26044097542762756,
      "pose_rmse_dy": 0.14064794778823853,
      "pose_rmse_mean": 0.2994301915168762,
      "rmse_dtheta": 0.05193951725959778,
      "rmse_dx": 0.02743680402636528,
      "rmse_dy": 0.012089190073311329,
      "rmse_mean": 0.030488505959510803,
      "rotation_flip": 0.008789722807705402,
      "sparse_tokens": 23246.0,
      "step": 4133,
      "turn_loss": 0.25312814116477966,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 35038.0,
      "epoch": 0.19206467199405314,
      "grad_norm": 0.5823785066604614,
      "learning_rate": 7.439067453428177e-06,
      "loss": 0.1968,
      "mae_dtheta": 0.03426859900355339,
      "mae_dx": 0.009672675281763077,
      "mae_dy": 0.0031405335757881403,
      "pose_mae_dtheta": 0.28081533312797546,
      "pose_mae_dx": 0.07717237621545792,
      "pose_mae_dy": 0.030899805948138237,
      "pose_rmse_dtheta": 0.4805278778076172,
      "pose_rmse_dx": 0.15936610102653503,
      "pose_rmse_dy": 0.07095427066087723,
      "pose_rmse_mean": 0.23694942891597748,
      "rmse_dtheta": 0.05157872289419174,
      "rmse_dx": 0.019711848348379135,
      "rmse_dy": 0.006436818279325962,
      "rmse_mean": 0.02590912953019142,
      "rotation_flip": 0.012742718681693077,
      "sparse_tokens": 26013.0,
      "step": 4134,
      "turn_loss": 0.2661586403846741,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.19211113175989594,
      "grad_norm": 0.5310757160186768,
      "learning_rate": 7.437913139774482e-06,
      "loss": 0.1084,
      "mae_dtheta": 0.03330126032233238,
      "mae_dx": 0.009140684269368649,
      "mae_dy": 0.006971778813749552,
      "pose_mae_dtheta": 0.2557436227798462,
      "pose_mae_dx": 0.0832766741514206,
      "pose_mae_dy": 0.07280050963163376,
      "pose_rmse_dtheta": 0.46276944875717163,
      "pose_rmse_dx": 0.18213769793510437,
      "pose_rmse_dy": 0.18537868559360504,
      "pose_rmse_mean": 0.2767619490623474,
      "rmse_dtheta": 0.05060592666268349,
      "rmse_dx": 0.018791722133755684,
      "rmse_dy": 0.01499228272587061,
      "rmse_mean": 0.028129978105425835,
      "rotation_flip": 0.007534984033554792,
      "sparse_tokens": 15287.0,
      "step": 4135,
      "turn_loss": 0.2881307899951935,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19215759152573872,
      "grad_norm": 0.5113271474838257,
      "learning_rate": 7.4367586556362125e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.009969653561711311,
      "mae_dx": 0.002265246817842126,
      "mae_dy": 0.0017434076871722937,
      "pose_mae_dtheta": 0.07465749233961105,
      "pose_mae_dx": 0.020789295434951782,
      "pose_mae_dy": 0.022909807041287422,
      "pose_rmse_dtheta": 0.22929389774799347,
      "pose_rmse_dx": 0.05571369454264641,
      "pose_rmse_dy": 0.052979350090026855,
      "pose_rmse_mean": 0.11266231536865234,
      "rmse_dtheta": 0.025397634133696556,
      "rmse_dx": 0.007511292118579149,
      "rmse_dy": 0.004222196061164141,
      "rmse_mean": 0.012377041392028332,
      "rotation_flip": 0.0032206119503825903,
      "sparse_tokens": 32089.0,
      "step": 4136,
      "turn_loss": 0.0734112560749054,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.1922040512915815,
      "grad_norm": 1.0829778909683228,
      "learning_rate": 7.435604001094102e-06,
      "loss": 0.2482,
      "mae_dtheta": 0.028161516413092613,
      "mae_dx": 0.015195158310234547,
      "mae_dy": 0.007295912131667137,
      "pose_mae_dtheta": 0.20815911889076233,
      "pose_mae_dx": 0.127710223197937,
      "pose_mae_dy": 0.10848993062973022,
      "pose_rmse_dtheta": 0.34769055247306824,
      "pose_rmse_dx": 0.2545487582683563,
      "pose_rmse_dy": 0.2356526255607605,
      "pose_rmse_mean": 0.2792973220348358,
      "rmse_dtheta": 0.04116338863968849,
      "rmse_dx": 0.028645958751440048,
      "rmse_dy": 0.014122936874628067,
      "rmse_mean": 0.02797742746770382,
      "rotation_flip": 0.012806829996407032,
      "sparse_tokens": 17182.0,
      "step": 4137,
      "turn_loss": 0.33028873801231384,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.19225051105742427,
      "grad_norm": 0.6952683925628662,
      "learning_rate": 7.434449176228897e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.007798341102898121,
      "mae_dx": 0.0018073157407343388,
      "mae_dy": 0.000562380300834775,
      "pose_mae_dtheta": 0.062088899314403534,
      "pose_mae_dx": 0.01548919826745987,
      "pose_mae_dy": 0.00874117761850357,
      "pose_rmse_dtheta": 0.24326269328594208,
      "pose_rmse_dx": 0.0361115001142025,
      "pose_rmse_dy": 0.02811836637556553,
      "pose_rmse_mean": 0.10249751806259155,
      "rmse_dtheta": 0.02672438696026802,
      "rmse_dx": 0.005121382884681225,
      "rmse_dy": 0.0013379466254264116,
      "rmse_mean": 0.011061239056289196,
      "rotation_flip": 0.001003009034320712,
      "sparse_tokens": 32217.0,
      "step": 4138,
      "turn_loss": 0.04488208144903183,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19229697082326705,
      "grad_norm": 0.5262538194656372,
      "learning_rate": 7.433294181121353e-06,
      "loss": 0.0968,
      "mae_dtheta": 0.008825772441923618,
      "mae_dx": 0.0019343774765729904,
      "mae_dy": 0.0022728880867362022,
      "pose_mae_dtheta": 0.06536693871021271,
      "pose_mae_dx": 0.023662371560931206,
      "pose_mae_dy": 0.025148484855890274,
      "pose_rmse_dtheta": 0.16959279775619507,
      "pose_rmse_dx": 0.06546039134263992,
      "pose_rmse_dy": 0.061738356947898865,
      "pose_rmse_mean": 0.09893052279949188,
      "rmse_dtheta": 0.021390119567513466,
      "rmse_dx": 0.005569109693169594,
      "rmse_dy": 0.0054252357222139835,
      "rmse_mean": 0.010794822126626968,
      "rotation_flip": 0.0031531532295048237,
      "sparse_tokens": 32089.0,
      "step": 4139,
      "turn_loss": 0.07191745936870575,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.19234343058910983,
      "grad_norm": 0.43186262249946594,
      "learning_rate": 7.432139015852242e-06,
      "loss": 0.1503,
      "mae_dtheta": 0.007122646551579237,
      "mae_dx": 0.0024183711502701044,
      "mae_dy": 0.0008027717703953385,
      "pose_mae_dtheta": 0.058872878551483154,
      "pose_mae_dx": 0.022182755172252655,
      "pose_mae_dy": 0.01348267961293459,
      "pose_rmse_dtheta": 0.2437315732240677,
      "pose_rmse_dx": 0.06358349323272705,
      "pose_rmse_dy": 0.045551642775535583,
      "pose_rmse_mean": 0.1176222413778305,
      "rmse_dtheta": 0.02526021935045719,
      "rmse_dx": 0.00767360907047987,
      "rmse_dy": 0.0019644720014184713,
      "rmse_mean": 0.0116327665746212,
      "rotation_flip": 0.0021291696466505527,
      "sparse_tokens": 32137.0,
      "step": 4140,
      "turn_loss": 0.07042259722948074,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1923898903549526,
      "grad_norm": 0.35184139013290405,
      "learning_rate": 7.430983680502344e-06,
      "loss": 0.0688,
      "mae_dtheta": 0.011019641533493996,
      "mae_dx": 0.001894170418381691,
      "mae_dy": 0.002061296021565795,
      "pose_mae_dtheta": 0.08042005449533463,
      "pose_mae_dx": 0.02173079550266266,
      "pose_mae_dy": 0.02524072863161564,
      "pose_rmse_dtheta": 0.24956999719142914,
      "pose_rmse_dx": 0.053559742867946625,
      "pose_rmse_dy": 0.06248781085014343,
      "pose_rmse_mean": 0.12187251448631287,
      "rmse_dtheta": 0.02823559008538723,
      "rmse_dx": 0.005258566699922085,
      "rmse_dy": 0.004778906237334013,
      "rmse_mean": 0.012757687829434872,
      "rotation_flip": 0.003832886228337884,
      "sparse_tokens": 32153.0,
      "step": 4141,
      "turn_loss": 0.07792419195175171,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.19243635012079538,
      "grad_norm": 0.5242244005203247,
      "learning_rate": 7.429828175152452e-06,
      "loss": 0.1085,
      "mae_dtheta": 0.03268001973628998,
      "mae_dx": 0.011154762469232082,
      "mae_dy": 0.003904482815414667,
      "pose_mae_dtheta": 0.2492917776107788,
      "pose_mae_dx": 0.06944532692432404,
      "pose_mae_dy": 0.04039320349693298,
      "pose_rmse_dtheta": 0.4060491621494293,
      "pose_rmse_dx": 0.16326455771923065,
      "pose_rmse_dy": 0.1186540499329567,
      "pose_rmse_mean": 0.22932259738445282,
      "rmse_dtheta": 0.04965890944004059,
      "rmse_dx": 0.023799477145075798,
      "rmse_dy": 0.007513345219194889,
      "rmse_mean": 0.026990577578544617,
      "rotation_flip": 0.021978022530674934,
      "sparse_tokens": 2692.0,
      "step": 4142,
      "turn_loss": 0.24125704169273376,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.19248280988663818,
      "grad_norm": 0.47446373105049133,
      "learning_rate": 7.428672499883372e-06,
      "loss": 0.1073,
      "mae_dtheta": 0.010646827518939972,
      "mae_dx": 0.0026526900473982096,
      "mae_dy": 0.0019261076813563704,
      "pose_mae_dtheta": 0.07698366791009903,
      "pose_mae_dx": 0.030485499650239944,
      "pose_mae_dy": 0.027730299159884453,
      "pose_rmse_dtheta": 0.21254439651966095,
      "pose_rmse_dx": 0.08463757485151291,
      "pose_rmse_dy": 0.0659671351313591,
      "pose_rmse_mean": 0.12104970216751099,
      "rmse_dtheta": 0.025893427431583405,
      "rmse_dx": 0.008657801896333694,
      "rmse_dy": 0.004288502503186464,
      "rmse_mean": 0.012946577742695808,
      "rotation_flip": 0.00418191310018301,
      "sparse_tokens": 32057.0,
      "step": 4143,
      "turn_loss": 0.08829701691865921,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.19252926965248096,
      "grad_norm": 0.982692539691925,
      "learning_rate": 7.427516654775921e-06,
      "loss": 0.2937,
      "mae_dtheta": 0.036881063133478165,
      "mae_dx": 0.020374778658151627,
      "mae_dy": 0.008715961128473282,
      "pose_mae_dtheta": 0.2867121994495392,
      "pose_mae_dx": 0.15426549315452576,
      "pose_mae_dy": 0.1001632809638977,
      "pose_rmse_dtheta": 0.46916651725769043,
      "pose_rmse_dx": 0.31557872891426086,
      "pose_rmse_dy": 0.20661132037639618,
      "pose_rmse_mean": 0.33045220375061035,
      "rmse_dtheta": 0.053911034017801285,
      "rmse_dx": 0.0356198325753212,
      "rmse_dy": 0.01645021326839924,
      "rmse_mean": 0.03532702848315239,
      "rotation_flip": 0.018743108958005905,
      "sparse_tokens": 16405.0,
      "step": 4144,
      "turn_loss": 0.3650224208831787,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19257572941832374,
      "grad_norm": 0.3341905474662781,
      "learning_rate": 7.426360639910927e-06,
      "loss": 0.089,
      "mae_dtheta": 0.0058008530177176,
      "mae_dx": 0.0012873595114797354,
      "mae_dy": 0.0006005470058880746,
      "pose_mae_dtheta": 0.0421743206679821,
      "pose_mae_dx": 0.011830128729343414,
      "pose_mae_dy": 0.010318022221326828,
      "pose_rmse_dtheta": 0.16697002947330475,
      "pose_rmse_dx": 0.03140156716108322,
      "pose_rmse_dy": 0.03213817626237869,
      "pose_rmse_mean": 0.07683658599853516,
      "rmse_dtheta": 0.021684763953089714,
      "rmse_dx": 0.0041266134940087795,
      "rmse_dy": 0.0014787062536925077,
      "rmse_mean": 0.009096695110201836,
      "rotation_flip": 0.0007331378292292356,
      "sparse_tokens": 32105.0,
      "step": 4145,
      "turn_loss": 0.03925235942006111,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.19262218918416651,
      "grad_norm": 0.4548840820789337,
      "learning_rate": 7.425204455369231e-06,
      "loss": 0.1197,
      "mae_dtheta": 0.0292361993342638,
      "mae_dx": 0.012813489884138107,
      "mae_dy": 0.005402272567152977,
      "pose_mae_dtheta": 0.24650564789772034,
      "pose_mae_dx": 0.11284565180540085,
      "pose_mae_dy": 0.07531652599573135,
      "pose_rmse_dtheta": 0.4271674156188965,
      "pose_rmse_dx": 0.22437910735607147,
      "pose_rmse_dy": 0.1622568517923355,
      "pose_rmse_mean": 0.2712678015232086,
      "rmse_dtheta": 0.043359074741601944,
      "rmse_dx": 0.02468147873878479,
      "rmse_dy": 0.009120331145823002,
      "rmse_mean": 0.025720294564962387,
      "rotation_flip": 0.008207933977246284,
      "sparse_tokens": 14400.0,
      "step": 4146,
      "turn_loss": 0.22100891172885895,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1926686489500093,
      "grad_norm": 0.5652095079421997,
      "learning_rate": 7.424048101231687e-06,
      "loss": 0.1643,
      "mae_dtheta": 0.008351616561412811,
      "mae_dx": 0.001628320780582726,
      "mae_dy": 0.0017467078287154436,
      "pose_mae_dtheta": 0.05987728759646416,
      "pose_mae_dx": 0.01906369999051094,
      "pose_mae_dy": 0.0203230157494545,
      "pose_rmse_dtheta": 0.17933683097362518,
      "pose_rmse_dx": 0.05194142088294029,
      "pose_rmse_dy": 0.04868524521589279,
      "pose_rmse_mean": 0.09332116693258286,
      "rmse_dtheta": 0.022729620337486267,
      "rmse_dx": 0.005461568478494883,
      "rmse_dy": 0.004943082574754953,
      "rmse_mean": 0.011044757440686226,
      "rotation_flip": 0.0035000001080334187,
      "sparse_tokens": 32089.0,
      "step": 4147,
      "turn_loss": 0.07091521471738815,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.19271510871585207,
      "grad_norm": 0.543946385383606,
      "learning_rate": 7.422891577579156e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.008672889322042465,
      "mae_dx": 0.0029480759985744953,
      "mae_dy": 0.002233931329101324,
      "pose_mae_dtheta": 0.05786769464612007,
      "pose_mae_dx": 0.026102541014552116,
      "pose_mae_dy": 0.02581995539367199,
      "pose_rmse_dtheta": 0.11888867616653442,
      "pose_rmse_dx": 0.061806172132492065,
      "pose_rmse_dy": 0.0563497468829155,
      "pose_rmse_mean": 0.0790148675441742,
      "rmse_dtheta": 0.018328852951526642,
      "rmse_dx": 0.007559268735349178,
      "rmse_dy": 0.004878546576946974,
      "rmse_mean": 0.010255556553602219,
      "rotation_flip": 0.003040669020265341,
      "sparse_tokens": 32185.0,
      "step": 4148,
      "turn_loss": 0.10796092450618744,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16190.0,
      "epoch": 0.19276156848169484,
      "grad_norm": 0.6514536738395691,
      "learning_rate": 7.421734884492518e-06,
      "loss": 0.1467,
      "mae_dtheta": 0.03797639161348343,
      "mae_dx": 0.008410481736063957,
      "mae_dy": 0.005807753186672926,
      "pose_mae_dtheta": 0.3180396854877472,
      "pose_mae_dx": 0.0745435580611229,
      "pose_mae_dy": 0.07141375541687012,
      "pose_rmse_dtheta": 0.5190125107765198,
      "pose_rmse_dx": 0.14398789405822754,
      "pose_rmse_dy": 0.15723687410354614,
      "pose_rmse_mean": 0.27341243624687195,
      "rmse_dtheta": 0.0546921007335186,
      "rmse_dx": 0.01731988787651062,
      "rmse_dy": 0.009913275018334389,
      "rmse_mean": 0.027308423072099686,
      "rotation_flip": 0.01706036739051342,
      "sparse_tokens": 13452.0,
      "step": 4149,
      "turn_loss": 0.27672675251960754,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.19280802824753762,
      "grad_norm": 0.29325735569000244,
      "learning_rate": 7.420578022052659e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.025190910324454308,
      "mae_dx": 0.006897753104567528,
      "mae_dy": 0.008539631962776184,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.29325729608535767,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 140.9868621826172,
      "model/head/act_norm_mean": 111.41336805555555,
      "model/head/act_norm_min": 72.58204650878906,
      "model/head/act_over_embed": 76.56430959616333,
      "model/head/grad_frac": 0.12833243608474731,
      "model/head/grad_norm": 0.03763442486524582,
      "model/head/grad_zero_frac": 0.0002011503092944622,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6931640625,
      "model/head/update_ratio": 0.0006463995086960495,
      "model/head/weight_delta": 7.604432106018066,
      "model/head/weight_delta_rel": 0.13340426981449127,
      "model/head/weight_norm": 58.221614837646484,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4179770052433014,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41792160531748895,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41787049174308777,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2871996398178921,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09270127862691879,
      "model/modality_embedder.encoders.pose/grad_norm": 0.02718532644212246,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5339673913043478,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0008803537348285317,
      "model/modality_embedder.encoders.pose/weight_delta": 2.4931983947753906,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08146056532859802,
      "model/modality_embedder.encoders.pose/weight_norm": 30.880002975463867,
      "model/modality_embedder/grad_frac": 0.09270127862691879,
      "model/modality_embedder/grad_norm": 0.02718532644212246,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5339673913043478,
      "model/modality_embedder/update_ratio": 0.0008803537348285317,
      "model/modality_embedder/weight_delta": 2.4931983947753906,
      "model/modality_embedder/weight_delta_rel": 0.08146056532859802,
      "model/modality_embedder/weight_norm": 30.880002975463867,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.37664794921875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.645968364197532,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.069849014282227,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.24973083692022,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10058453679084778,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02949714846909046,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001062671304680407,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.7954962253570557,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0654289647936821,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.75754737854004,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 82.06300354003906,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.528769841269842,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.81540584564209,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.856400276881956,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10200833529233932,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02991468831896782,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001016341964714229,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.2710530757904053,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07867105305194855,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.433685302734375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.9439468383789,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.243791335978838,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.113645553588867,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.034979104330183,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10270263254642487,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030118295922875404,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000991164706647396,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.436851978302002,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08182492852210999,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.38677215576172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.77127075195312,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.236196538800705,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.351868629455566,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.404178612900765,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10751654207706451,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03153001144528389,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010618057567626238,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.081538677215576,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07113711535930634,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.694705963134766,
      "model/normalizer/grad_frac": 0.427082359790802,
      "model/normalizer/grad_norm": 0.12524501979351044,
      "model/normalizer/grad_zero_frac": 0.0002079859550576657,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0015999418683350086,
      "model/normalizer/weight_delta": 4.4198899269104,
      "model/normalizer/weight_delta_rel": 0.05692562460899353,
      "model/normalizer/weight_norm": 78.2809829711914,
      "pose_mae_dtheta": 0.1851515769958496,
      "pose_mae_dx": 0.07850126922130585,
      "pose_mae_dy": 0.0952681228518486,
      "pose_rmse_dtheta": 0.35773372650146484,
      "pose_rmse_dx": 0.17884086072444916,
      "pose_rmse_dy": 0.18632808327674866,
      "pose_rmse_mean": 0.2409675568342209,
      "rmse_dtheta": 0.03986517712473869,
      "rmse_dx": 0.01774188131093979,
      "rmse_dy": 0.01505034975707531,
      "rmse_mean": 0.02421913668513298,
      "rotation_flip": 0.013554217293858528,
      "sparse_tokens": 12388.0,
      "step": 4150,
      "turn_loss": 0.24309049546718597,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.19285448801338043,
      "grad_norm": 0.6166635751724243,
      "learning_rate": 7.41942099034048e-06,
      "loss": 0.1873,
      "mae_dtheta": 0.028236959129571915,
      "mae_dx": 0.004452270455658436,
      "mae_dy": 0.006160811986774206,
      "pose_mae_dtheta": 0.219144806265831,
      "pose_mae_dx": 0.05783451348543167,
      "pose_mae_dy": 0.11020135134458542,
      "pose_rmse_dtheta": 0.3671787679195404,
      "pose_rmse_dx": 0.1744164675474167,
      "pose_rmse_dy": 0.24306808412075043,
      "pose_rmse_mean": 0.26155444979667664,
      "rmse_dtheta": 0.042139142751693726,
      "rmse_dx": 0.014681505039334297,
      "rmse_dy": 0.012228959240019321,
      "rmse_mean": 0.023016534745693207,
      "rotation_flip": 0.016627078875899315,
      "sparse_tokens": 8579.0,
      "step": 4151,
      "turn_loss": 0.24399064481258392,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.1929009477792232,
      "grad_norm": 0.5929096937179565,
      "learning_rate": 7.418263789436892e-06,
      "loss": 0.2286,
      "mae_dtheta": 0.037086497992277145,
      "mae_dx": 0.00977787934243679,
      "mae_dy": 0.0057054078206419945,
      "pose_mae_dtheta": 0.2784428894519806,
      "pose_mae_dx": 0.08406472951173782,
      "pose_mae_dy": 0.07053733617067337,
      "pose_rmse_dtheta": 0.459789514541626,
      "pose_rmse_dx": 0.19660016894340515,
      "pose_rmse_dy": 0.15880310535430908,
      "pose_rmse_mean": 0.2717309594154358,
      "rmse_dtheta": 0.05341837555170059,
      "rmse_dx": 0.02133476361632347,
      "rmse_dy": 0.011665500700473785,
      "rmse_mean": 0.028806213289499283,
      "rotation_flip": 0.016252389177680016,
      "sparse_tokens": 17724.0,
      "step": 4152,
      "turn_loss": 0.28500357270240784,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.19294740754506598,
      "grad_norm": 0.35117730498313904,
      "learning_rate": 7.4171064194228196e-06,
      "loss": 0.095,
      "mae_dtheta": 0.008932634256780148,
      "mae_dx": 0.0014664442278444767,
      "mae_dy": 0.0027526486665010452,
      "pose_mae_dtheta": 0.059957247227430344,
      "pose_mae_dx": 0.024863434955477715,
      "pose_mae_dy": 0.027794888243079185,
      "pose_rmse_dtheta": 0.1475648432970047,
      "pose_rmse_dx": 0.0801338255405426,
      "pose_rmse_dy": 0.07240986078977585,
      "pose_rmse_mean": 0.10003617405891418,
      "rmse_dtheta": 0.021665209904313087,
      "rmse_dx": 0.004624375607818365,
      "rmse_dy": 0.006930938921868801,
      "rmse_mean": 0.011073509231209755,
      "rotation_flip": 0.0069808028638362885,
      "sparse_tokens": 32025.0,
      "step": 4153,
      "turn_loss": 0.07360675185918808,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19299386731090876,
      "grad_norm": 0.3598829209804535,
      "learning_rate": 7.415948880379198e-06,
      "loss": 0.09,
      "mae_dtheta": 0.012046536430716515,
      "mae_dx": 0.0025373189710080624,
      "mae_dy": 0.003083314746618271,
      "pose_mae_dtheta": 0.08381935209035873,
      "pose_mae_dx": 0.02605842612683773,
      "pose_mae_dy": 0.03487665206193924,
      "pose_rmse_dtheta": 0.19148321449756622,
      "pose_rmse_dx": 0.0700671374797821,
      "pose_rmse_dy": 0.0814751386642456,
      "pose_rmse_mean": 0.1143418401479721,
      "rmse_dtheta": 0.025315407663583755,
      "rmse_dx": 0.007600779179483652,
      "rmse_dy": 0.008322754874825478,
      "rmse_mean": 0.013746313750743866,
      "rotation_flip": 0.003935458604246378,
      "sparse_tokens": 32105.0,
      "step": 4154,
      "turn_loss": 0.10155298560857773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.19304032707675153,
      "grad_norm": 0.389992356300354,
      "learning_rate": 7.414791172386975e-06,
      "loss": 0.0897,
      "mae_dtheta": 0.011396536603569984,
      "mae_dx": 0.0015822019195184112,
      "mae_dy": 0.002483481541275978,
      "pose_mae_dtheta": 0.07094937562942505,
      "pose_mae_dx": 0.02291851118206978,
      "pose_mae_dy": 0.02927100844681263,
      "pose_rmse_dtheta": 0.14739196002483368,
      "pose_rmse_dx": 0.055792439728975296,
      "pose_rmse_dy": 0.05844094604253769,
      "pose_rmse_mean": 0.08720844984054565,
      "rmse_dtheta": 0.02248729020357132,
      "rmse_dx": 0.004881302826106548,
      "rmse_dy": 0.004918201826512814,
      "rmse_mean": 0.010762265883386135,
      "rotation_flip": 0.0075329565443098545,
      "sparse_tokens": 32073.0,
      "step": 4155,
      "turn_loss": 0.08080048859119415,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1930867868425943,
      "grad_norm": 0.3677615821361542,
      "learning_rate": 7.413633295527109e-06,
      "loss": 0.0664,
      "mae_dtheta": 0.004880009684711695,
      "mae_dx": 0.0010578532237559557,
      "mae_dy": 0.00031016315915621817,
      "pose_mae_dtheta": 0.03542599827051163,
      "pose_mae_dx": 0.008393828757107258,
      "pose_mae_dy": 0.004445385187864304,
      "pose_rmse_dtheta": 0.17838022112846375,
      "pose_rmse_dx": 0.02135731279850006,
      "pose_rmse_dy": 0.013848966918885708,
      "pose_rmse_mean": 0.07119549810886383,
      "rmse_dtheta": 0.02202751860022545,
      "rmse_dx": 0.0031394169200211763,
      "rmse_dy": 0.0007423735223710537,
      "rmse_mean": 0.008636437356472015,
      "rotation_flip": 0.0062949638813734055,
      "sparse_tokens": 32121.0,
      "step": 4156,
      "turn_loss": 0.03427029401063919,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.1931332466084371,
      "grad_norm": 0.3882659375667572,
      "learning_rate": 7.4124752498805704e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.050481949001550674,
      "mae_dx": 0.016475509852170944,
      "mae_dy": 0.004119770135730505,
      "pose_mae_dtheta": 0.43323323130607605,
      "pose_mae_dx": 0.12890909612178802,
      "pose_mae_dy": 0.04329350218176842,
      "pose_rmse_dtheta": 0.6608346104621887,
      "pose_rmse_dx": 0.27472782135009766,
      "pose_rmse_dy": 0.11129291355609894,
      "pose_rmse_mean": 0.3489517867565155,
      "rmse_dtheta": 0.06788794696331024,
      "rmse_dx": 0.029134264215826988,
      "rmse_dy": 0.008634998463094234,
      "rmse_mean": 0.03521907329559326,
      "rotation_flip": 0.018842529505491257,
      "sparse_tokens": 11924.0,
      "step": 4157,
      "turn_loss": 0.2993697226047516,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.19317970637427986,
      "grad_norm": 0.9671064615249634,
      "learning_rate": 7.411317035528345e-06,
      "loss": 0.1122,
      "mae_dtheta": 0.032998718321323395,
      "mae_dx": 0.009900664910674095,
      "mae_dy": 0.004357307218015194,
      "pose_mae_dtheta": 0.2570352554321289,
      "pose_mae_dx": 0.08169810473918915,
      "pose_mae_dy": 0.05318601429462433,
      "pose_rmse_dtheta": 0.46815982460975647,
      "pose_rmse_dx": 0.17595896124839783,
      "pose_rmse_dy": 0.10867329686880112,
      "pose_rmse_mean": 0.25093069672584534,
      "rmse_dtheta": 0.05033484473824501,
      "rmse_dx": 0.021220175549387932,
      "rmse_dy": 0.007104307878762484,
      "rmse_mean": 0.026219775900244713,
      "rotation_flip": 0.020797226577997208,
      "sparse_tokens": 9139.0,
      "step": 4158,
      "turn_loss": 0.245399609208107,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 20711.0,
      "epoch": 0.19322616614012264,
      "grad_norm": 0.47095900774002075,
      "learning_rate": 7.410158652551421e-06,
      "loss": 0.1636,
      "mae_dtheta": 0.04298488050699234,
      "mae_dx": 0.011736488901078701,
      "mae_dy": 0.008492092601954937,
      "pose_mae_dtheta": 0.332960307598114,
      "pose_mae_dx": 0.10061756521463394,
      "pose_mae_dy": 0.09800880402326584,
      "pose_rmse_dtheta": 0.5565086007118225,
      "pose_rmse_dx": 0.2446002960205078,
      "pose_rmse_dy": 0.2434719353914261,
      "pose_rmse_mean": 0.34819361567497253,
      "rmse_dtheta": 0.059724438935518265,
      "rmse_dx": 0.023661568760871887,
      "rmse_dy": 0.019120633602142334,
      "rmse_mean": 0.03416888043284416,
      "rotation_flip": 0.013211382552981377,
      "sparse_tokens": 16230.0,
      "step": 4159,
      "turn_loss": 0.33649659156799316,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19327262590596545,
      "grad_norm": 0.4804936349391937,
      "learning_rate": 7.4090001010308125e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.00919349305331707,
      "mae_dx": 0.00205087848007679,
      "mae_dy": 0.0030972242821007967,
      "pose_mae_dtheta": 0.06247073784470558,
      "pose_mae_dx": 0.027902575209736824,
      "pose_mae_dy": 0.02745153196156025,
      "pose_rmse_dtheta": 0.16373607516288757,
      "pose_rmse_dx": 0.06959495693445206,
      "pose_rmse_dy": 0.060580670833587646,
      "pose_rmse_mean": 0.09797056764364243,
      "rmse_dtheta": 0.019575072452425957,
      "rmse_dx": 0.005127509590238333,
      "rmse_dy": 0.0068458509631454945,
      "rmse_mean": 0.010516144335269928,
      "rotation_flip": 0.0027591644320636988,
      "sparse_tokens": 32089.0,
      "step": 4160,
      "turn_loss": 0.08281654864549637,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.19331908567180822,
      "grad_norm": 0.3675301671028137,
      "learning_rate": 7.407841381047533e-06,
      "loss": 0.108,
      "mae_dtheta": 0.011884375475347042,
      "mae_dx": 0.0032817532774060965,
      "mae_dy": 0.0022107637487351894,
      "pose_mae_dtheta": 0.07996276021003723,
      "pose_mae_dx": 0.03588855639100075,
      "pose_mae_dy": 0.03022836521267891,
      "pose_rmse_dtheta": 0.2090042382478714,
      "pose_rmse_dx": 0.11761409044265747,
      "pose_rmse_dy": 0.06901481002569199,
      "pose_rmse_mean": 0.13187772035598755,
      "rmse_dtheta": 0.025859275832772255,
      "rmse_dx": 0.011436711065471172,
      "rmse_dy": 0.00425289710983634,
      "rmse_mean": 0.01384962722659111,
      "rotation_flip": 0.0063492064364254475,
      "sparse_tokens": 32073.0,
      "step": 4161,
      "turn_loss": 0.10911793261766434,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.193365545437651,
      "grad_norm": 0.9105979800224304,
      "learning_rate": 7.406682492682612e-06,
      "loss": 0.246,
      "mae_dtheta": 0.04481130465865135,
      "mae_dx": 0.019692610949277878,
      "mae_dy": 0.005382881965488195,
      "pose_mae_dtheta": 0.4145946204662323,
      "pose_mae_dx": 0.1495194286108017,
      "pose_mae_dy": 0.0832212045788765,
      "pose_rmse_dtheta": 0.6758959889411926,
      "pose_rmse_dx": 0.28935733437538147,
      "pose_rmse_dy": 0.15767797827720642,
      "pose_rmse_mean": 0.3743104636669159,
      "rmse_dtheta": 0.06387408077716827,
      "rmse_dx": 0.03293726220726967,
      "rmse_dy": 0.008901825174689293,
      "rmse_mean": 0.03523772209882736,
      "rotation_flip": 0.008130080997943878,
      "sparse_tokens": 8435.0,
      "step": 4162,
      "turn_loss": 0.30025261640548706,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.19341200520349378,
      "grad_norm": 0.5688408613204956,
      "learning_rate": 7.4055234360170935e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.03965792804956436,
      "mae_dx": 0.010516471229493618,
      "mae_dy": 0.004210037179291248,
      "pose_mae_dtheta": 0.3116855025291443,
      "pose_mae_dx": 0.08224831521511078,
      "pose_mae_dy": 0.04330262169241905,
      "pose_rmse_dtheta": 0.5821100473403931,
      "pose_rmse_dx": 0.20873257517814636,
      "pose_rmse_dy": 0.09763691574335098,
      "pose_rmse_mean": 0.29615986347198486,
      "rmse_dtheta": 0.06133703887462616,
      "rmse_dx": 0.023256098851561546,
      "rmse_dy": 0.00829547643661499,
      "rmse_mean": 0.030962873250246048,
      "rotation_flip": 0.011904762126505375,
      "sparse_tokens": 11155.0,
      "step": 4163,
      "turn_loss": 0.24298015236854553,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.19345846496933655,
      "grad_norm": 0.7333797216415405,
      "learning_rate": 7.40436421113203e-06,
      "loss": 0.0793,
      "mae_dtheta": 0.030072113499045372,
      "mae_dx": 0.009086593985557556,
      "mae_dy": 0.004189124796539545,
      "pose_mae_dtheta": 0.24670740962028503,
      "pose_mae_dx": 0.07233141362667084,
      "pose_mae_dy": 0.036075182259082794,
      "pose_rmse_dtheta": 0.45388028025627136,
      "pose_rmse_dx": 0.2069992870092392,
      "pose_rmse_dy": 0.06925337016582489,
      "pose_rmse_mean": 0.2433776557445526,
      "rmse_dtheta": 0.0503905825316906,
      "rmse_dx": 0.021767348051071167,
      "rmse_dy": 0.008692336268723011,
      "rmse_mean": 0.026950091123580933,
      "rotation_flip": 0.004640371073037386,
      "sparse_tokens": 7003.0,
      "step": 4164,
      "turn_loss": 0.21899402141571045,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19350492473517933,
      "grad_norm": 0.30065542459487915,
      "learning_rate": 7.403204818108487e-06,
      "loss": 0.0716,
      "mae_dtheta": 0.010076497681438923,
      "mae_dx": 0.0021393371280282736,
      "mae_dy": 0.0028027750086039305,
      "pose_mae_dtheta": 0.06992504000663757,
      "pose_mae_dx": 0.02568216808140278,
      "pose_mae_dy": 0.02921648509800434,
      "pose_rmse_dtheta": 0.18772633373737335,
      "pose_rmse_dx": 0.07797519117593765,
      "pose_rmse_dy": 0.06841053068637848,
      "pose_rmse_mean": 0.11137068271636963,
      "rmse_dtheta": 0.0227659922093153,
      "rmse_dx": 0.007205295842140913,
      "rmse_dy": 0.007064684759825468,
      "rmse_mean": 0.012345324270427227,
      "rotation_flip": 0.005065123084932566,
      "sparse_tokens": 32105.0,
      "step": 4165,
      "turn_loss": 0.09227008372545242,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1935513845010221,
      "grad_norm": 0.43467065691947937,
      "learning_rate": 7.402045257027541e-06,
      "loss": 0.1403,
      "mae_dtheta": 0.007432129234075546,
      "mae_dx": 0.0015032984083518386,
      "mae_dy": 0.0009326672879979014,
      "pose_mae_dtheta": 0.0587729811668396,
      "pose_mae_dx": 0.015033723786473274,
      "pose_mae_dy": 0.014963126741349697,
      "pose_rmse_dtheta": 0.20010104775428772,
      "pose_rmse_dx": 0.04080451652407646,
      "pose_rmse_dy": 0.04038026183843613,
      "pose_rmse_mean": 0.09376194328069687,
      "rmse_dtheta": 0.02228247933089733,
      "rmse_dx": 0.005041137803345919,
      "rmse_dy": 0.0021143555641174316,
      "rmse_mean": 0.009812657721340656,
      "rotation_flip": 0.0019193857442587614,
      "sparse_tokens": 32089.0,
      "step": 4166,
      "turn_loss": 0.07056094706058502,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.19359784426686488,
      "grad_norm": 0.48447659611701965,
      "learning_rate": 7.400885527970281e-06,
      "loss": 0.1149,
      "mae_dtheta": 0.014382049441337585,
      "mae_dx": 0.0026824313681572676,
      "mae_dy": 0.004494831431657076,
      "pose_mae_dtheta": 0.08982421457767487,
      "pose_mae_dx": 0.03627832606434822,
      "pose_mae_dy": 0.04594320431351662,
      "pose_rmse_dtheta": 0.197660893201828,
      "pose_rmse_dx": 0.1025371178984642,
      "pose_rmse_dy": 0.11213848739862442,
      "pose_rmse_mean": 0.13744550943374634,
      "rmse_dtheta": 0.02790951356291771,
      "rmse_dx": 0.00816280022263527,
      "rmse_dy": 0.010344518348574638,
      "rmse_mean": 0.015472277998924255,
      "rotation_flip": 0.007117437664419413,
      "sparse_tokens": 32073.0,
      "step": 4167,
      "turn_loss": 0.1386822760105133,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1936443040327077,
      "grad_norm": 0.49469074606895447,
      "learning_rate": 7.399725631017808e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.01838170364499092,
      "mae_dx": 0.00331705529242754,
      "mae_dy": 0.003594523062929511,
      "pose_mae_dtheta": 0.12375538796186447,
      "pose_mae_dx": 0.027524292469024658,
      "pose_mae_dy": 0.03163590654730797,
      "pose_rmse_dtheta": 0.3137592375278473,
      "pose_rmse_dx": 0.0687485858798027,
      "pose_rmse_dy": 0.08006807416677475,
      "pose_rmse_mean": 0.1541919708251953,
      "rmse_dtheta": 0.03788109868764877,
      "rmse_dx": 0.009557805955410004,
      "rmse_dy": 0.009123834781348705,
      "rmse_mean": 0.01885424740612507,
      "rotation_flip": 0.009478673338890076,
      "sparse_tokens": 32153.0,
      "step": 4168,
      "turn_loss": 0.15572494268417358,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 46594.0,
      "epoch": 0.19369076379855046,
      "grad_norm": 1.0211637020111084,
      "learning_rate": 7.398565566251232e-06,
      "loss": 0.2828,
      "mae_dtheta": 0.03535003215074539,
      "mae_dx": 0.014759210869669914,
      "mae_dy": 0.00499784667044878,
      "pose_mae_dtheta": 0.2885495722293854,
      "pose_mae_dx": 0.1255720853805542,
      "pose_mae_dy": 0.051593389362096786,
      "pose_rmse_dtheta": 0.5270451903343201,
      "pose_rmse_dx": 0.2652242183685303,
      "pose_rmse_dy": 0.1128464788198471,
      "pose_rmse_mean": 0.3017053008079529,
      "rmse_dtheta": 0.05424819141626358,
      "rmse_dx": 0.027896981686353683,
      "rmse_dy": 0.010865827091038227,
      "rmse_mean": 0.031003667041659355,
      "rotation_flip": 0.01791957952082157,
      "sparse_tokens": 30394.0,
      "step": 4169,
      "turn_loss": 0.29215699434280396,
      "turns": 144.0,
      "turns_per_sample": 144.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.19373722356439324,
      "grad_norm": 0.46980026364326477,
      "learning_rate": 7.397405333751679e-06,
      "loss": 0.0856,
      "mae_dtheta": 0.007774187717586756,
      "mae_dx": 0.0014476630603894591,
      "mae_dy": 0.0006433791713789105,
      "pose_mae_dtheta": 0.05544835329055786,
      "pose_mae_dx": 0.013329965993762016,
      "pose_mae_dy": 0.009836426936089993,
      "pose_rmse_dtheta": 0.21435661613941193,
      "pose_rmse_dx": 0.032334137707948685,
      "pose_rmse_dy": 0.02971431240439415,
      "pose_rmse_mean": 0.09213502705097198,
      "rmse_dtheta": 0.0262569859623909,
      "rmse_dx": 0.004377035424113274,
      "rmse_dy": 0.0017657473217695951,
      "rmse_mean": 0.010799923911690712,
      "rotation_flip": 0.0,
      "sparse_tokens": 32137.0,
      "step": 4170,
      "turn_loss": 0.049103833734989166,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.19378368333023602,
      "grad_norm": 0.4955734312534332,
      "learning_rate": 7.396244933600285e-06,
      "loss": 0.1623,
      "mae_dtheta": 0.008297106251120567,
      "mae_dx": 0.0018046455224975944,
      "mae_dy": 0.0014706148067489266,
      "pose_mae_dtheta": 0.059955328702926636,
      "pose_mae_dx": 0.0214823167771101,
      "pose_mae_dy": 0.02349509857594967,
      "pose_rmse_dtheta": 0.1643553078174591,
      "pose_rmse_dx": 0.06486726552248001,
      "pose_rmse_dy": 0.05768991634249687,
      "pose_rmse_mean": 0.0956374928355217,
      "rmse_dtheta": 0.019694561138749123,
      "rmse_dx": 0.0068152896128594875,
      "rmse_dy": 0.003310460364446044,
      "rmse_mean": 0.009940104559063911,
      "rotation_flip": 0.002853881334885955,
      "sparse_tokens": 32057.0,
      "step": 4171,
      "turn_loss": 0.0653870552778244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.1938301430960788,
      "grad_norm": 0.5298647880554199,
      "learning_rate": 7.395084365878196e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.02623460628092289,
      "mae_dx": 0.012929679825901985,
      "mae_dy": 0.0036549996584653854,
      "pose_mae_dtheta": 0.19559277594089508,
      "pose_mae_dx": 0.10795717686414719,
      "pose_mae_dy": 0.05578793212771416,
      "pose_rmse_dtheta": 0.3758711516857147,
      "pose_rmse_dx": 0.261484295129776,
      "pose_rmse_dy": 0.12854593992233276,
      "pose_rmse_mean": 0.25530046224594116,
      "rmse_dtheta": 0.043044187128543854,
      "rmse_dx": 0.027826951816678047,
      "rmse_dy": 0.006507155951112509,
      "rmse_mean": 0.025792766362428665,
      "rotation_flip": 0.01291989628225565,
      "sparse_tokens": 16993.0,
      "step": 4172,
      "turn_loss": 0.2045149803161621,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.19387660286192157,
      "grad_norm": 0.5752512812614441,
      "learning_rate": 7.393923630666572e-06,
      "loss": 0.0977,
      "mae_dtheta": 0.010067155584692955,
      "mae_dx": 0.0013820459134876728,
      "mae_dy": 0.0015788762830197811,
      "pose_mae_dtheta": 0.07328719645738602,
      "pose_mae_dx": 0.0162009596824646,
      "pose_mae_dy": 0.0237575676292181,
      "pose_rmse_dtheta": 0.2143479883670807,
      "pose_rmse_dx": 0.043656349182128906,
      "pose_rmse_dy": 0.06027461588382721,
      "pose_rmse_mean": 0.10609298944473267,
      "rmse_dtheta": 0.025340737774968147,
      "rmse_dx": 0.004319924861192703,
      "rmse_dy": 0.00325568113476038,
      "rmse_mean": 0.010972115211188793,
      "rotation_flip": 0.001617468660697341,
      "sparse_tokens": 32121.0,
      "step": 4173,
      "turn_loss": 0.07598629593849182,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3917.0,
      "epoch": 0.19392306262776435,
      "grad_norm": 0.4564419090747833,
      "learning_rate": 7.392762728046584e-06,
      "loss": 0.0692,
      "mae_dtheta": 0.032505035400390625,
      "mae_dx": 0.009045825339853764,
      "mae_dy": 0.00743618281558156,
      "pose_mae_dtheta": 0.2837066650390625,
      "pose_mae_dx": 0.07436463981866837,
      "pose_mae_dy": 0.11116524785757065,
      "pose_rmse_dtheta": 0.48889949917793274,
      "pose_rmse_dx": 0.19478395581245422,
      "pose_rmse_dy": 0.20035326480865479,
      "pose_rmse_mean": 0.2946789264678955,
      "rmse_dtheta": 0.052671756595373154,
      "rmse_dx": 0.020045600831508636,
      "rmse_dy": 0.011151276528835297,
      "rmse_mean": 0.02795621007680893,
      "rotation_flip": 0.005464480724185705,
      "sparse_tokens": 3224.0,
      "step": 4174,
      "turn_loss": 0.22066950798034668,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.19396952239360712,
      "grad_norm": 0.6485246419906616,
      "learning_rate": 7.391601658099414e-06,
      "loss": 0.2112,
      "mae_dtheta": 0.035312023013830185,
      "mae_dx": 0.01950717903673649,
      "mae_dy": 0.015822282060980797,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6485247015953064,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 144.63807678222656,
      "model/head/act_norm_mean": 102.8367919921875,
      "model/head/act_norm_min": 58.58243942260742,
      "model/head/act_over_embed": 70.67040623024663,
      "model/head/grad_frac": 0.12759625911712646,
      "model/head/grad_norm": 0.08274932950735092,
      "model/head/grad_zero_frac": 0.00019131487351842225,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6928932883522727,
      "model/head/update_ratio": 0.0014211477246135473,
      "model/head/weight_delta": 7.626822471618652,
      "model/head/weight_delta_rel": 0.1337970495223999,
      "model/head/weight_norm": 58.22711181640625,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4179035425186157,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41785736083984376,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41779598593711853,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28715549041138805,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09799539297819138,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06355243176221848,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5404079861111111,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0020579728297889233,
      "model/modality_embedder.encoders.pose/weight_delta": 2.5011425018310547,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08172012120485306,
      "model/modality_embedder.encoders.pose/weight_norm": 30.88108253479004,
      "model/modality_embedder/grad_frac": 0.09799539297819138,
      "model/modality_embedder/grad_norm": 0.06355243176221848,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5404079861111111,
      "model/modality_embedder/update_ratio": 0.0020579728297889233,
      "model/modality_embedder/weight_delta": 2.5011425018310547,
      "model/modality_embedder/weight_delta_rel": 0.08172012120485306,
      "model/modality_embedder/weight_norm": 30.88108253479004,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.73815155029297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.123969888618326,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.075590133666992,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.891008597475468,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08158279210329056,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05290845409035683,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019059665501117706,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.8034677505493164,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06571945548057556,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.759382247924805,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 80.04801177978516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.955393781565657,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.729578018188477,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.462370880621997,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08448445051908493,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.054790250957012177,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001861290424130857,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.2807204723358154,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07900594174861908,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.43670082092285,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.42198944091797,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.7400229978355,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.316390991210938,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.688784786004593,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07655376195907593,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.049647003412246704,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0003026145859621465,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016336612170562148,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.447943687438965,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08219736814498901,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.390024185180664,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.87921905517578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.06236471861472,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.472063064575195,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.284719758629816,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07186444103717804,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04660586640238762,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015693778404965997,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.0909550189971924,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07145892083644867,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.697032928466797,
      "model/normalizer/grad_frac": 0.2651030123233795,
      "model/normalizer/grad_norm": 0.1719258576631546,
      "model/normalizer/grad_zero_frac": 0.0002505285374354571,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021961741149425507,
      "model/normalizer/weight_delta": 4.439481258392334,
      "model/normalizer/weight_delta_rel": 0.05717794969677925,
      "model/normalizer/weight_norm": 78.28425598144531,
      "pose_mae_dtheta": 0.27824002504348755,
      "pose_mae_dx": 0.16196346282958984,
      "pose_mae_dy": 0.17582730948925018,
      "pose_rmse_dtheta": 0.49841198325157166,
      "pose_rmse_dx": 0.31672245264053345,
      "pose_rmse_dy": 0.332451730966568,
      "pose_rmse_mean": 0.38252872228622437,
      "rmse_dtheta": 0.055778104811906815,
      "rmse_dx": 0.03279093652963638,
      "rmse_dy": 0.026537582278251648,
      "rmse_mean": 0.03836887702345848,
      "rotation_flip": 0.015479875728487968,
      "sparse_tokens": 12189.0,
      "step": 4175,
      "turn_loss": 0.39916667342185974,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.19401598215944993,
      "grad_norm": 0.5503710508346558,
      "learning_rate": 7.390440420906257e-06,
      "loss": 0.1556,
      "mae_dtheta": 0.014822586439549923,
      "mae_dx": 0.0035773871932178736,
      "mae_dy": 0.0052577476017177105,
      "pose_mae_dtheta": 0.10205662995576859,
      "pose_mae_dx": 0.03735392913222313,
      "pose_mae_dy": 0.04420474171638489,
      "pose_rmse_dtheta": 0.25854599475860596,
      "pose_rmse_dx": 0.08833567053079605,
      "pose_rmse_dy": 0.11990351974964142,
      "pose_rmse_mean": 0.155595064163208,
      "rmse_dtheta": 0.03237832710146904,
      "rmse_dx": 0.00998620968312025,
      "rmse_dy": 0.012296190485358238,
      "rmse_mean": 0.018220243975520134,
      "rotation_flip": 0.008248232305049896,
      "sparse_tokens": 32073.0,
      "step": 4176,
      "turn_loss": 0.15795698761940002,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.1940624419252927,
      "grad_norm": 0.5728474259376526,
      "learning_rate": 7.3892790165483164e-06,
      "loss": 0.1483,
      "mae_dtheta": 0.03700103983283043,
      "mae_dx": 0.009454295039176941,
      "mae_dy": 0.008928138762712479,
      "pose_mae_dtheta": 0.2711072862148285,
      "pose_mae_dx": 0.08459768444299698,
      "pose_mae_dy": 0.1316172182559967,
      "pose_rmse_dtheta": 0.45647481083869934,
      "pose_rmse_dx": 0.19805167615413666,
      "pose_rmse_dy": 0.2753160297870636,
      "pose_rmse_mean": 0.30994749069213867,
      "rmse_dtheta": 0.05463719367980957,
      "rmse_dx": 0.022243909537792206,
      "rmse_dy": 0.015450856648385525,
      "rmse_mean": 0.03077732026576996,
      "rotation_flip": 0.024793388321995735,
      "sparse_tokens": 3665.0,
      "step": 4177,
      "turn_loss": 0.26365768909454346,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.19410890169113548,
      "grad_norm": 0.3388332724571228,
      "learning_rate": 7.388117445106813e-06,
      "loss": 0.0923,
      "mae_dtheta": 0.005400101654231548,
      "mae_dx": 0.0012996001169085503,
      "mae_dy": 0.0010966649278998375,
      "pose_mae_dtheta": 0.03745483234524727,
      "pose_mae_dx": 0.012876840308308601,
      "pose_mae_dy": 0.016788681969046593,
      "pose_rmse_dtheta": 0.07775058597326279,
      "pose_rmse_dx": 0.029118439182639122,
      "pose_rmse_dy": 0.046214379370212555,
      "pose_rmse_mean": 0.0510278046131134,
      "rmse_dtheta": 0.01351372990757227,
      "rmse_dx": 0.003596871392801404,
      "rmse_dy": 0.0027558195870369673,
      "rmse_mean": 0.006622140295803547,
      "rotation_flip": 0.004066877532750368,
      "sparse_tokens": 32169.0,
      "step": 4178,
      "turn_loss": 0.04239104315638542,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.19415536145697826,
      "grad_norm": 0.8852072358131409,
      "learning_rate": 7.386955706662975e-06,
      "loss": 0.1501,
      "mae_dtheta": 0.029160017147660255,
      "mae_dx": 0.012797628529369831,
      "mae_dy": 0.00392646761611104,
      "pose_mae_dtheta": 0.1979673206806183,
      "pose_mae_dx": 0.10605425387620926,
      "pose_mae_dy": 0.05838605761528015,
      "pose_rmse_dtheta": 0.37392425537109375,
      "pose_rmse_dx": 0.2280234843492508,
      "pose_rmse_dy": 0.1476454734802246,
      "pose_rmse_mean": 0.249864399433136,
      "rmse_dtheta": 0.047860611230134964,
      "rmse_dx": 0.0263490229845047,
      "rmse_dy": 0.00805051252245903,
      "rmse_mean": 0.027420049533247948,
      "rotation_flip": 0.003389830468222499,
      "sparse_tokens": 4418.0,
      "step": 4179,
      "turn_loss": 0.2064269483089447,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.19420182122282104,
      "grad_norm": 0.4791901409626007,
      "learning_rate": 7.3857938012980425e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.007569268811494112,
      "mae_dx": 0.0011096984380856156,
      "mae_dy": 0.0011701466282829642,
      "pose_mae_dtheta": 0.05122331529855728,
      "pose_mae_dx": 0.012146077118813992,
      "pose_mae_dy": 0.01882903464138508,
      "pose_rmse_dtheta": 0.1564241498708725,
      "pose_rmse_dx": 0.028035925701260567,
      "pose_rmse_dy": 0.04447685554623604,
      "pose_rmse_mean": 0.07631231099367142,
      "rmse_dtheta": 0.020250646397471428,
      "rmse_dx": 0.0038711181841790676,
      "rmse_dy": 0.0023805121891200542,
      "rmse_mean": 0.008834092877805233,
      "rotation_flip": 0.0019890600815415382,
      "sparse_tokens": 32073.0,
      "step": 4180,
      "turn_loss": 0.04950140789151192,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.1942482809886638,
      "grad_norm": 0.5955979228019714,
      "learning_rate": 7.38463172909327e-06,
      "loss": 0.1492,
      "mae_dtheta": 0.0278182253241539,
      "mae_dx": 0.009746975265443325,
      "mae_dy": 0.0040403869934380054,
      "pose_mae_dtheta": 0.18463215231895447,
      "pose_mae_dx": 0.08147827535867691,
      "pose_mae_dy": 0.04594198614358902,
      "pose_rmse_dtheta": 0.31442496180534363,
      "pose_rmse_dx": 0.1806565821170807,
      "pose_rmse_dy": 0.09340750426054001,
      "pose_rmse_mean": 0.19616302847862244,
      "rmse_dtheta": 0.04345862567424774,
      "rmse_dx": 0.020380858331918716,
      "rmse_dy": 0.007136458531022072,
      "rmse_mean": 0.023658646270632744,
      "rotation_flip": 0.012773722410202026,
      "sparse_tokens": 8401.0,
      "step": 4181,
      "turn_loss": 0.27443549036979675,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 22972.0,
      "epoch": 0.1942947407545066,
      "grad_norm": 0.5278285145759583,
      "learning_rate": 7.383469490129919e-06,
      "loss": 0.14,
      "mae_dtheta": 0.03380044177174568,
      "mae_dx": 0.015488917008042336,
      "mae_dy": 0.0061171590350568295,
      "pose_mae_dtheta": 0.26016104221343994,
      "pose_mae_dx": 0.11909757554531097,
      "pose_mae_dy": 0.07880055159330368,
      "pose_rmse_dtheta": 0.4961674213409424,
      "pose_rmse_dx": 0.258465439081192,
      "pose_rmse_dy": 0.20418888330459595,
      "pose_rmse_mean": 0.3196072578430176,
      "rmse_dtheta": 0.052805691957473755,
      "rmse_dx": 0.028863858431577682,
      "rmse_dy": 0.01275995559990406,
      "rmse_mean": 0.03147650510072708,
      "rotation_flip": 0.014395393431186676,
      "sparse_tokens": 17505.0,
      "step": 4182,
      "turn_loss": 0.24401909112930298,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.19434120052034937,
      "grad_norm": 0.5149484276771545,
      "learning_rate": 7.382307084489269e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.04745986685156822,
      "mae_dx": 0.020695669576525688,
      "mae_dy": 0.01451120711863041,
      "pose_mae_dtheta": 0.39958006143569946,
      "pose_mae_dx": 0.2180747389793396,
      "pose_mae_dy": 0.1564406007528305,
      "pose_rmse_dtheta": 0.6247113943099976,
      "pose_rmse_dx": 0.41456636786460876,
      "pose_rmse_dy": 0.3589138090610504,
      "pose_rmse_mean": 0.46606385707855225,
      "rmse_dtheta": 0.06497839093208313,
      "rmse_dx": 0.03430783376097679,
      "rmse_dy": 0.02800014615058899,
      "rmse_mean": 0.042428791522979736,
      "rotation_flip": 0.020408162847161293,
      "sparse_tokens": 13070.0,
      "step": 4183,
      "turn_loss": 0.5424568057060242,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.19438766028619217,
      "grad_norm": 0.48565998673439026,
      "learning_rate": 7.381144512252606e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.03028656356036663,
      "mae_dx": 0.006329761352390051,
      "mae_dy": 0.005339010618627071,
      "pose_mae_dtheta": 0.22276239097118378,
      "pose_mae_dx": 0.05322698876261711,
      "pose_mae_dy": 0.054391685873270035,
      "pose_rmse_dtheta": 0.43065565824508667,
      "pose_rmse_dx": 0.11998216807842255,
      "pose_rmse_dy": 0.10664377361536026,
      "pose_rmse_mean": 0.21909388899803162,
      "rmse_dtheta": 0.048489317297935486,
      "rmse_dx": 0.01490139588713646,
      "rmse_dy": 0.008986718952655792,
      "rmse_mean": 0.02412581257522106,
      "rotation_flip": 0.009791921824216843,
      "sparse_tokens": 15684.0,
      "step": 4184,
      "turn_loss": 0.2473837435245514,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.19443412005203495,
      "grad_norm": 0.49344199895858765,
      "learning_rate": 7.3799817735012295e-06,
      "loss": 0.1519,
      "mae_dtheta": 0.012833374552428722,
      "mae_dx": 0.003662942908704281,
      "mae_dy": 0.005217033438384533,
      "pose_mae_dtheta": 0.08611497282981873,
      "pose_mae_dx": 0.04498286172747612,
      "pose_mae_dy": 0.0482715405523777,
      "pose_rmse_dtheta": 0.18717913329601288,
      "pose_rmse_dx": 0.11448159068822861,
      "pose_rmse_dy": 0.12732766568660736,
      "pose_rmse_mean": 0.14299613237380981,
      "rmse_dtheta": 0.026245998218655586,
      "rmse_dx": 0.010102907195687294,
      "rmse_dy": 0.012751584872603416,
      "rmse_mean": 0.016366830095648766,
      "rotation_flip": 0.006791171617805958,
      "sparse_tokens": 32153.0,
      "step": 4185,
      "turn_loss": 0.14583812654018402,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.19448057981787772,
      "grad_norm": 0.5066362023353577,
      "learning_rate": 7.378818868316449e-06,
      "loss": 0.0936,
      "mae_dtheta": 0.04011807590723038,
      "mae_dx": 0.013995591551065445,
      "mae_dy": 0.005034490954130888,
      "pose_mae_dtheta": 0.29980748891830444,
      "pose_mae_dx": 0.12116365134716034,
      "pose_mae_dy": 0.08304785937070847,
      "pose_rmse_dtheta": 0.496216356754303,
      "pose_rmse_dx": 0.26302477717399597,
      "pose_rmse_dy": 0.1873694360256195,
      "pose_rmse_mean": 0.31553685665130615,
      "rmse_dtheta": 0.05838145315647125,
      "rmse_dx": 0.027590574696660042,
      "rmse_dy": 0.008864795789122581,
      "rmse_mean": 0.031612277030944824,
      "rotation_flip": 0.019438445568084717,
      "sparse_tokens": 7499.0,
      "step": 4186,
      "turn_loss": 0.28127655386924744,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1945270395837205,
      "grad_norm": 0.48464998602867126,
      "learning_rate": 7.377655796779588e-06,
      "loss": 0.1254,
      "mae_dtheta": 0.008100577630102634,
      "mae_dx": 0.0011945319129154086,
      "mae_dy": 0.001115116523578763,
      "pose_mae_dtheta": 0.05119004100561142,
      "pose_mae_dx": 0.013604696840047836,
      "pose_mae_dy": 0.014504401944577694,
      "pose_rmse_dtheta": 0.17296193540096283,
      "pose_rmse_dx": 0.03345635533332825,
      "pose_rmse_dy": 0.03794856742024422,
      "pose_rmse_mean": 0.08145561814308167,
      "rmse_dtheta": 0.023072896525263786,
      "rmse_dx": 0.0039393543265759945,
      "rmse_dy": 0.002585646230727434,
      "rmse_mean": 0.009865965694189072,
      "rotation_flip": 0.0021030493080615997,
      "sparse_tokens": 32105.0,
      "step": 4187,
      "turn_loss": 0.05838716775178909,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34606.0,
      "epoch": 0.19457349934956328,
      "grad_norm": 1.035414457321167,
      "learning_rate": 7.376492558971983e-06,
      "loss": 0.2336,
      "mae_dtheta": 0.03494551405310631,
      "mae_dx": 0.010404037311673164,
      "mae_dy": 0.004175063222646713,
      "pose_mae_dtheta": 0.2522889971733093,
      "pose_mae_dx": 0.08312388509511948,
      "pose_mae_dy": 0.0541372150182724,
      "pose_rmse_dtheta": 0.4296637773513794,
      "pose_rmse_dx": 0.19635258615016937,
      "pose_rmse_dy": 0.12999866902828217,
      "pose_rmse_mean": 0.25200504064559937,
      "rmse_dtheta": 0.05180223658680916,
      "rmse_dx": 0.02294766716659069,
      "rmse_dy": 0.008744042366743088,
      "rmse_mean": 0.027831315994262695,
      "rotation_flip": 0.007697241846472025,
      "sparse_tokens": 25097.0,
      "step": 4188,
      "turn_loss": 0.2660732567310333,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.19461995911540605,
      "grad_norm": 0.70088791847229,
      "learning_rate": 7.3753291549749764e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.033729635179042816,
      "mae_dx": 0.015808362513780594,
      "mae_dy": 0.003458186285570264,
      "pose_mae_dtheta": 0.2982989549636841,
      "pose_mae_dx": 0.12539485096931458,
      "pose_mae_dy": 0.057356785982847214,
      "pose_rmse_dtheta": 0.5590525269508362,
      "pose_rmse_dx": 0.26414623856544495,
      "pose_rmse_dy": 0.1479402631521225,
      "pose_rmse_mean": 0.3237130343914032,
      "rmse_dtheta": 0.055737897753715515,
      "rmse_dx": 0.02957688458263874,
      "rmse_dy": 0.007527297828346491,
      "rmse_mean": 0.030947361141443253,
      "rotation_flip": 0.006097560748457909,
      "sparse_tokens": 5341.0,
      "step": 4189,
      "turn_loss": 0.18775354325771332,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.19466641888124883,
      "grad_norm": 0.6330314874649048,
      "learning_rate": 7.374165584869927e-06,
      "loss": 0.0725,
      "mae_dtheta": 0.008639300242066383,
      "mae_dx": 0.001964694820344448,
      "mae_dy": 0.001737196114845574,
      "pose_mae_dtheta": 0.06329997628927231,
      "pose_mae_dx": 0.02290368266403675,
      "pose_mae_dy": 0.023464927449822426,
      "pose_rmse_dtheta": 0.17619429528713226,
      "pose_rmse_dx": 0.06581603735685349,
      "pose_rmse_dy": 0.06342241168022156,
      "pose_rmse_mean": 0.10181091725826263,
      "rmse_dtheta": 0.02052070014178753,
      "rmse_dx": 0.006447552237659693,
      "rmse_dy": 0.00396529259160161,
      "rmse_mean": 0.010311181657016277,
      "rotation_flip": 0.003537139855325222,
      "sparse_tokens": 32073.0,
      "step": 4190,
      "turn_loss": 0.07450419664382935,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18773.0,
      "epoch": 0.1947128786470916,
      "grad_norm": 0.7530692219734192,
      "learning_rate": 7.373001848738203e-06,
      "loss": 0.2551,
      "mae_dtheta": 0.04803035035729408,
      "mae_dx": 0.01635228656232357,
      "mae_dy": 0.007487371098250151,
      "pose_mae_dtheta": 0.4269573390483856,
      "pose_mae_dx": 0.1441839635372162,
      "pose_mae_dy": 0.0971580520272255,
      "pose_rmse_dtheta": 0.6746189594268799,
      "pose_rmse_dx": 0.2719542980194092,
      "pose_rmse_dy": 0.20020721852779388,
      "pose_rmse_mean": 0.38226017355918884,
      "rmse_dtheta": 0.06630805134773254,
      "rmse_dx": 0.028672151267528534,
      "rmse_dy": 0.015319766476750374,
      "rmse_mean": 0.0367666557431221,
      "rotation_flip": 0.013993541710078716,
      "sparse_tokens": 14498.0,
      "step": 4191,
      "turn_loss": 0.4175863564014435,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.19475933841293439,
      "grad_norm": 0.3857860267162323,
      "learning_rate": 7.371837946661187e-06,
      "loss": 0.0957,
      "mae_dtheta": 0.01352358516305685,
      "mae_dx": 0.0034598009660840034,
      "mae_dy": 0.004201443400233984,
      "pose_mae_dtheta": 0.10432762652635574,
      "pose_mae_dx": 0.03264465183019638,
      "pose_mae_dy": 0.03589916601777077,
      "pose_rmse_dtheta": 0.23367443680763245,
      "pose_rmse_dx": 0.07512778788805008,
      "pose_rmse_dy": 0.0883483812212944,
      "pose_rmse_mean": 0.1323835402727127,
      "rmse_dtheta": 0.02781049907207489,
      "rmse_dx": 0.010143214836716652,
      "rmse_dy": 0.01018710806965828,
      "rmse_mean": 0.01604694128036499,
      "rotation_flip": 0.0049923197366297245,
      "sparse_tokens": 32121.0,
      "step": 4192,
      "turn_loss": 0.15074938535690308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1948057981787772,
      "grad_norm": 0.3229689300060272,
      "learning_rate": 7.37067387872027e-06,
      "loss": 0.0735,
      "mae_dtheta": 0.006037808023393154,
      "mae_dx": 0.0015262420056387782,
      "mae_dy": 0.0016548441490158439,
      "pose_mae_dtheta": 0.04172774776816368,
      "pose_mae_dx": 0.01742793433368206,
      "pose_mae_dy": 0.01601674221456051,
      "pose_rmse_dtheta": 0.13426586985588074,
      "pose_rmse_dx": 0.04594554007053375,
      "pose_rmse_dy": 0.04103570431470871,
      "pose_rmse_mean": 0.07374903559684753,
      "rmse_dtheta": 0.01813669130206108,
      "rmse_dx": 0.004740305710583925,
      "rmse_dy": 0.005322971381247044,
      "rmse_mean": 0.009399989619851112,
      "rotation_flip": 0.002853881334885955,
      "sparse_tokens": 32073.0,
      "step": 4193,
      "turn_loss": 0.053403642028570175,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.19485225794461997,
      "grad_norm": 0.45700109004974365,
      "learning_rate": 7.369509644996857e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.009908865205943584,
      "mae_dx": 0.0013651209883391857,
      "mae_dy": 0.0017262534238398075,
      "pose_mae_dtheta": 0.06974572688341141,
      "pose_mae_dx": 0.017500294372439384,
      "pose_mae_dy": 0.022785281762480736,
      "pose_rmse_dtheta": 0.2093403935432434,
      "pose_rmse_dx": 0.04214533045887947,
      "pose_rmse_dy": 0.05243651196360588,
      "pose_rmse_mean": 0.10130741447210312,
      "rmse_dtheta": 0.0236184224486351,
      "rmse_dx": 0.0043516624718904495,
      "rmse_dy": 0.0035504410043358803,
      "rmse_mean": 0.010506842285394669,
      "rotation_flip": 0.0030421556439250708,
      "sparse_tokens": 32073.0,
      "step": 4194,
      "turn_loss": 0.07021193206310272,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.19489871771046274,
      "grad_norm": 0.6773606538772583,
      "learning_rate": 7.368345245572362e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.032675910741090775,
      "mae_dx": 0.009497462771832943,
      "mae_dy": 0.0035599838010966778,
      "pose_mae_dtheta": 0.22939811646938324,
      "pose_mae_dx": 0.06293664127588272,
      "pose_mae_dy": 0.03911124914884567,
      "pose_rmse_dtheta": 0.4225849211215973,
      "pose_rmse_dx": 0.13755321502685547,
      "pose_rmse_dy": 0.07844962179660797,
      "pose_rmse_mean": 0.21286258101463318,
      "rmse_dtheta": 0.052197109907865524,
      "rmse_dx": 0.02042885683476925,
      "rmse_dy": 0.006576037034392357,
      "rmse_mean": 0.026400668546557426,
      "rotation_flip": 0.013812154531478882,
      "sparse_tokens": 6320.0,
      "step": 4195,
      "turn_loss": 0.22518426179885864,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.19494517747630552,
      "grad_norm": 0.3802928030490875,
      "learning_rate": 7.367180680528215e-06,
      "loss": 0.0832,
      "mae_dtheta": 0.02476467937231064,
      "mae_dx": 0.007907948456704617,
      "mae_dy": 0.003295439062640071,
      "pose_mae_dtheta": 0.20423531532287598,
      "pose_mae_dx": 0.07071151584386826,
      "pose_mae_dy": 0.03662734851241112,
      "pose_rmse_dtheta": 0.4309866726398468,
      "pose_rmse_dx": 0.1906118094921112,
      "pose_rmse_dy": 0.07931528985500336,
      "pose_rmse_mean": 0.23363792896270752,
      "rmse_dtheta": 0.04475150257349014,
      "rmse_dx": 0.018809016793966293,
      "rmse_dy": 0.006570485420525074,
      "rmse_mean": 0.02337700128555298,
      "rotation_flip": 0.006329114083200693,
      "sparse_tokens": 7985.0,
      "step": 4196,
      "turn_loss": 0.1680442988872528,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.1949916372421483,
      "grad_norm": 0.5307474732398987,
      "learning_rate": 7.366015949945848e-06,
      "loss": 0.1286,
      "mae_dtheta": 0.011080670170485973,
      "mae_dx": 0.0018744143890216947,
      "mae_dy": 0.0024428139440715313,
      "pose_mae_dtheta": 0.0791490226984024,
      "pose_mae_dx": 0.026251204311847687,
      "pose_mae_dy": 0.02995448186993599,
      "pose_rmse_dtheta": 0.2075977623462677,
      "pose_rmse_dx": 0.08180470019578934,
      "pose_rmse_dy": 0.07599449902772903,
      "pose_rmse_mean": 0.12179898470640182,
      "rmse_dtheta": 0.025503329932689667,
      "rmse_dx": 0.005695774685591459,
      "rmse_dy": 0.005760006606578827,
      "rmse_mean": 0.01231970451772213,
      "rotation_flip": 0.0031347961630672216,
      "sparse_tokens": 32025.0,
      "step": 4197,
      "turn_loss": 0.10061626136302948,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19503809700799107,
      "grad_norm": 0.5327944159507751,
      "learning_rate": 7.364851053906719e-06,
      "loss": 0.0977,
      "mae_dtheta": 0.009991364553570747,
      "mae_dx": 0.0018793347990140319,
      "mae_dy": 0.0027687614783644676,
      "pose_mae_dtheta": 0.06540855020284653,
      "pose_mae_dx": 0.02552897483110428,
      "pose_mae_dy": 0.027448438107967377,
      "pose_rmse_dtheta": 0.1616799235343933,
      "pose_rmse_dx": 0.06413789838552475,
      "pose_rmse_dy": 0.06372489035129547,
      "pose_rmse_mean": 0.0965142473578453,
      "rmse_dtheta": 0.020443256944417953,
      "rmse_dx": 0.0047624860890209675,
      "rmse_dy": 0.006072032265365124,
      "rmse_mean": 0.010425925254821777,
      "rotation_flip": 0.004991087131202221,
      "sparse_tokens": 32105.0,
      "step": 4198,
      "turn_loss": 0.0838153213262558,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.19508455677383385,
      "grad_norm": 0.6254426836967468,
      "learning_rate": 7.363685992492286e-06,
      "loss": 0.1768,
      "mae_dtheta": 0.03556903824210167,
      "mae_dx": 0.022411495447158813,
      "mae_dy": 0.010896807536482811,
      "pose_mae_dtheta": 0.29039615392684937,
      "pose_mae_dx": 0.19819700717926025,
      "pose_mae_dy": 0.10309040546417236,
      "pose_rmse_dtheta": 0.4923298954963684,
      "pose_rmse_dx": 0.32260558009147644,
      "pose_rmse_dy": 0.20930348336696625,
      "pose_rmse_mean": 0.3414129912853241,
      "rmse_dtheta": 0.05435314401984215,
      "rmse_dx": 0.03301043435931206,
      "rmse_dy": 0.021390672773122787,
      "rmse_mean": 0.03625141829252243,
      "rotation_flip": 0.009900989942252636,
      "sparse_tokens": 3131.0,
      "step": 4199,
      "turn_loss": 0.4652095139026642,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.19513101653967663,
      "grad_norm": 0.4702517092227936,
      "learning_rate": 7.362520765784022e-06,
      "loss": 0.135,
      "mae_dtheta": 0.03796348720788956,
      "mae_dx": 0.012090818956494331,
      "mae_dy": 0.011844483204185963,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4702517092227936,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 139.482177734375,
      "model/head/act_norm_mean": 105.24546412417763,
      "model/head/act_norm_min": 83.24360656738281,
      "model/head/act_over_embed": 72.32566826969402,
      "model/head/grad_frac": 0.10541554540395737,
      "model/head/grad_norm": 0.049571841955184937,
      "model/head/grad_zero_frac": 0.0001894112501759082,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6964432565789473,
      "model/head/update_ratio": 0.0008512781350873411,
      "model/head/weight_delta": 7.650522232055664,
      "model/head/weight_delta_rel": 0.13421282172203064,
      "model/head/weight_norm": 58.23225021362305,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4179491698741913,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4179491698741913,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4179491698741913,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2872185824393214,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08051956444978714,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03786446154117584,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001226110034622252,
      "model/modality_embedder.encoders.pose/weight_delta": 2.507321357727051,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0819220021367073,
      "model/modality_embedder.encoders.pose/weight_norm": 30.88178062438965,
      "model/modality_embedder/grad_frac": 0.08051956444978714,
      "model/modality_embedder/grad_norm": 0.03786446154117584,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.001226110034622252,
      "model/modality_embedder/weight_delta": 2.507321357727051,
      "model/modality_embedder/weight_delta_rel": 0.0819220021367073,
      "model/modality_embedder/weight_norm": 30.88178062438965,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.11328887939453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.14454756683375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.102264404296875,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.905149770596365,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07458505779504776,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03507374972105026,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012633769074454904,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.8116079568862915,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06601608544588089,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.761903762817383,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 75.0570068359375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.93794708124478,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.734254837036133,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.450381344822908,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07380927354097366,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.034708935767412186,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00030765816336497664,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011789866257458925,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.290189743041992,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07933396100997925,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.439634323120117,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 77.4229965209961,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.62312356411863,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.455615043640137,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.608450400724617,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07135070115327835,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03355278819799423,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011039698729291558,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.4588539600372314,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08256371319293976,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.392847061157227,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.98704528808594,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.648424446533,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.212244033813477,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.000256128285372,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06794799119234085,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03195266053080559,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010758928256109357,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.099363088607788,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07174626737833023,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.69873809814453,
      "model/normalizer/grad_frac": 0.2529028654098511,
      "model/normalizer/grad_norm": 0.11892800778150558,
      "model/normalizer/grad_zero_frac": 0.000252892030403018,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001519120647571981,
      "model/normalizer/weight_delta": 4.4584879875183105,
      "model/normalizer/weight_delta_rel": 0.05742274224758148,
      "model/normalizer/weight_norm": 78.28739929199219,
      "pose_mae_dtheta": 0.31927528977394104,
      "pose_mae_dx": 0.09043735265731812,
      "pose_mae_dy": 0.1331002563238144,
      "pose_rmse_dtheta": 0.5294343829154968,
      "pose_rmse_dx": 0.17219887673854828,
      "pose_rmse_dy": 0.257852703332901,
      "pose_rmse_mean": 0.31982868909835815,
      "rmse_dtheta": 0.057166848331689835,
      "rmse_dx": 0.023600028827786446,
      "rmse_dy": 0.020304210484027863,
      "rmse_mean": 0.03369036316871643,
      "rotation_flip": 0.01230769231915474,
      "sparse_tokens": 5225.0,
      "step": 4200,
      "turn_loss": 0.36565348505973816,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "epoch": 0.19513101653967663,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31401392817497253,
      "eval_objectnav_nopose_mae_dtheta": 0.03995528817176819,
      "eval_objectnav_nopose_mae_dx": 0.013826725073158741,
      "eval_objectnav_nopose_mae_dy": 0.0048786490224301815,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32400399446487427,
      "eval_objectnav_nopose_pose_mae_dx": 0.11092010885477066,
      "eval_objectnav_nopose_pose_mae_dy": 0.05614156275987625,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5471338033676147,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24050705134868622,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1337660253047943,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3071356415748596,
      "eval_objectnav_nopose_rmse_dtheta": 0.05770363658666611,
      "eval_objectnav_nopose_rmse_dx": 0.026714107021689415,
      "eval_objectnav_nopose_rmse_dy": 0.009920916520059109,
      "eval_objectnav_nopose_rmse_mean": 0.031446222215890884,
      "eval_objectnav_nopose_rotation_flip": 0.014644143171608448,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31401392817497253,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 4200
    },
    {
      "epoch": 0.19513101653967663,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28530359268188477,
      "eval_objectnav_pose_mae_dtheta": 0.035909254103899,
      "eval_objectnav_pose_mae_dx": 0.011403374373912811,
      "eval_objectnav_pose_mae_dy": 0.004606578499078751,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27517980337142944,
      "eval_objectnav_pose_pose_mae_dx": 0.09153491258621216,
      "eval_objectnav_pose_pose_mae_dy": 0.04945019260048866,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.48083704710006714,
      "eval_objectnav_pose_pose_rmse_dx": 0.2111496925354004,
      "eval_objectnav_pose_pose_rmse_dy": 0.12093710899353027,
      "eval_objectnav_pose_pose_rmse_mean": 0.27097463607788086,
      "eval_objectnav_pose_rmse_dtheta": 0.05357323959469795,
      "eval_objectnav_pose_rmse_dx": 0.023700498044490814,
      "eval_objectnav_pose_rmse_dy": 0.009892541915178299,
      "eval_objectnav_pose_rmse_mean": 0.029055427759885788,
      "eval_objectnav_pose_rotation_flip": 0.014100640080869198,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28530359268188477,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 4200
    },
    {
      "epoch": 0.19513101653967663,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09781462699174881,
      "eval_pointnav_mae_dtheta": 0.01112337689846754,
      "eval_pointnav_mae_dx": 0.002647694665938616,
      "eval_pointnav_mae_dy": 0.0025404084008187056,
      "eval_pointnav_pose_mae_dtheta": 0.0798461064696312,
      "eval_pointnav_pose_mae_dx": 0.02950710989534855,
      "eval_pointnav_pose_mae_dy": 0.028338821604847908,
      "eval_pointnav_pose_rmse_dtheta": 0.21924230456352234,
      "eval_pointnav_pose_rmse_dx": 0.08659067004919052,
      "eval_pointnav_pose_rmse_dy": 0.08206357806921005,
      "eval_pointnav_pose_rmse_mean": 0.1292988657951355,
      "eval_pointnav_rmse_dtheta": 0.02641589380800724,
      "eval_pointnav_rmse_dx": 0.008162719197571278,
      "eval_pointnav_rmse_dy": 0.006892848294228315,
      "eval_pointnav_rmse_mean": 0.01382382120937109,
      "eval_pointnav_rotation_flip": 0.005204450339078903,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09781462699174881,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 4200
    },
    {
      "epoch": 0.19513101653967663,
      "eval_loss": 0.23237738261620203,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31401392817497253,
      "eval_objectnav_nopose_mae_dtheta": 0.03995528817176819,
      "eval_objectnav_nopose_mae_dx": 0.013826725073158741,
      "eval_objectnav_nopose_mae_dy": 0.0048786490224301815,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32400399446487427,
      "eval_objectnav_nopose_pose_mae_dx": 0.11092010885477066,
      "eval_objectnav_nopose_pose_mae_dy": 0.05614156275987625,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5471338033676147,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24050705134868622,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1337660253047943,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3071356415748596,
      "eval_objectnav_nopose_rmse_dtheta": 0.05770363658666611,
      "eval_objectnav_nopose_rmse_dx": 0.026714107021689415,
      "eval_objectnav_nopose_rmse_dy": 0.009920916520059109,
      "eval_objectnav_nopose_rmse_mean": 0.031446222215890884,
      "eval_objectnav_nopose_rotation_flip": 0.014644143171608448,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31401392817497253,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28530359268188477,
      "eval_objectnav_pose_mae_dtheta": 0.035909254103899,
      "eval_objectnav_pose_mae_dx": 0.011403374373912811,
      "eval_objectnav_pose_mae_dy": 0.004606578499078751,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27517980337142944,
      "eval_objectnav_pose_pose_mae_dx": 0.09153491258621216,
      "eval_objectnav_pose_pose_mae_dy": 0.04945019260048866,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.48083704710006714,
      "eval_objectnav_pose_pose_rmse_dx": 0.2111496925354004,
      "eval_objectnav_pose_pose_rmse_dy": 0.12093710899353027,
      "eval_objectnav_pose_pose_rmse_mean": 0.27097463607788086,
      "eval_objectnav_pose_rmse_dtheta": 0.05357323959469795,
      "eval_objectnav_pose_rmse_dx": 0.023700498044490814,
      "eval_objectnav_pose_rmse_dy": 0.009892541915178299,
      "eval_objectnav_pose_rmse_mean": 0.029055427759885788,
      "eval_objectnav_pose_rotation_flip": 0.014100640080869198,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28530359268188477,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09781462699174881,
      "eval_pointnav_mae_dtheta": 0.01112337689846754,
      "eval_pointnav_mae_dx": 0.002647694665938616,
      "eval_pointnav_mae_dy": 0.0025404084008187056,
      "eval_pointnav_pose_mae_dtheta": 0.0798461064696312,
      "eval_pointnav_pose_mae_dx": 0.02950710989534855,
      "eval_pointnav_pose_mae_dy": 0.028338821604847908,
      "eval_pointnav_pose_rmse_dtheta": 0.21924230456352234,
      "eval_pointnav_pose_rmse_dx": 0.08659067004919052,
      "eval_pointnav_pose_rmse_dy": 0.08206357806921005,
      "eval_pointnav_pose_rmse_mean": 0.1292988657951355,
      "eval_pointnav_rmse_dtheta": 0.02641589380800724,
      "eval_pointnav_rmse_dx": 0.008162719197571278,
      "eval_pointnav_rmse_dy": 0.006892848294228315,
      "eval_pointnav_rmse_mean": 0.01382382120937109,
      "eval_pointnav_rotation_flip": 0.005204450339078903,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09781462699174881,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 4200
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19517747630551943,
      "grad_norm": 0.37970995903015137,
      "learning_rate": 7.361355373863415e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.01107473112642765,
      "mae_dx": 0.0014799429336562753,
      "mae_dy": 0.002675853669643402,
      "pose_mae_dtheta": 0.06850317120552063,
      "pose_mae_dx": 0.022187365218997,
      "pose_mae_dy": 0.03272804617881775,
      "pose_rmse_dtheta": 0.13038517534732819,
      "pose_rmse_dx": 0.05326386168599129,
      "pose_rmse_dy": 0.07676704227924347,
      "pose_rmse_mean": 0.08680536597967148,
      "rmse_dtheta": 0.01972009800374508,
      "rmse_dx": 0.004055459052324295,
      "rmse_dy": 0.005134523846209049,
      "rmse_mean": 0.009636694565415382,
      "rotation_flip": 0.006724949460476637,
      "sparse_tokens": 32105.0,
      "step": 4201,
      "turn_loss": 0.09561070799827576,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.1952239360713622,
      "grad_norm": 0.48602956533432007,
      "learning_rate": 7.360189816811957e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.010187068022787571,
      "mae_dx": 0.0018369215540587902,
      "mae_dy": 0.0016112918965518475,
      "pose_mae_dtheta": 0.07007429003715515,
      "pose_mae_dx": 0.01654796488583088,
      "pose_mae_dy": 0.01899385266005993,
      "pose_rmse_dtheta": 0.1865166425704956,
      "pose_rmse_dx": 0.03756723925471306,
      "pose_rmse_dy": 0.04853033646941185,
      "pose_rmse_mean": 0.0908714085817337,
      "rmse_dtheta": 0.024568455293774605,
      "rmse_dx": 0.005039834883064032,
      "rmse_dy": 0.004224163945764303,
      "rmse_mean": 0.011277484707534313,
      "rotation_flip": 0.003132341429591179,
      "sparse_tokens": 32217.0,
      "step": 4202,
      "turn_loss": 0.07369820773601532,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.19527039583720499,
      "grad_norm": 0.70026695728302,
      "learning_rate": 7.359024094711159e-06,
      "loss": 0.1868,
      "mae_dtheta": 0.043529659509658813,
      "mae_dx": 0.009488857351243496,
      "mae_dy": 0.0025471081025898457,
      "pose_mae_dtheta": 0.3582994043827057,
      "pose_mae_dx": 0.08222789317369461,
      "pose_mae_dy": 0.01925790123641491,
      "pose_rmse_dtheta": 0.606889009475708,
      "pose_rmse_dx": 0.18379096686840057,
      "pose_rmse_dy": 0.048340313136577606,
      "pose_rmse_mean": 0.2796734571456909,
      "rmse_dtheta": 0.06427096575498581,
      "rmse_dx": 0.019975999370217323,
      "rmse_dy": 0.006423449609428644,
      "rmse_mean": 0.03022347204387188,
      "rotation_flip": 0.013513513840734959,
      "sparse_tokens": 10725.0,
      "step": 4203,
      "turn_loss": 0.31182900071144104,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19531685560304776,
      "grad_norm": 0.4491370916366577,
      "learning_rate": 7.3578582076425406e-06,
      "loss": 0.1259,
      "mae_dtheta": 0.011802694760262966,
      "mae_dx": 0.0023049742449074984,
      "mae_dy": 0.003465749090537429,
      "pose_mae_dtheta": 0.07832610607147217,
      "pose_mae_dx": 0.030715739354491234,
      "pose_mae_dy": 0.03860359266400337,
      "pose_rmse_dtheta": 0.14054693281650543,
      "pose_rmse_dx": 0.06671428680419922,
      "pose_rmse_dy": 0.07633150368928909,
      "pose_rmse_mean": 0.09453091025352478,
      "rmse_dtheta": 0.019780771806836128,
      "rmse_dx": 0.005812366493046284,
      "rmse_dy": 0.00665702112019062,
      "rmse_mean": 0.010750053450465202,
      "rotation_flip": 0.0024286580737680197,
      "sparse_tokens": 32105.0,
      "step": 4204,
      "turn_loss": 0.10966311395168304,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.19536331536889054,
      "grad_norm": 0.5550568699836731,
      "learning_rate": 7.356692155687631e-06,
      "loss": 0.1338,
      "mae_dtheta": 0.03122567944228649,
      "mae_dx": 0.010198415257036686,
      "mae_dy": 0.005910997744649649,
      "pose_mae_dtheta": 0.23595088720321655,
      "pose_mae_dx": 0.0831388384103775,
      "pose_mae_dy": 0.0746578648686409,
      "pose_rmse_dtheta": 0.44412198662757874,
      "pose_rmse_dx": 0.2186485081911087,
      "pose_rmse_dy": 0.20985668897628784,
      "pose_rmse_mean": 0.29087573289871216,
      "rmse_dtheta": 0.050198134034872055,
      "rmse_dx": 0.022426914423704147,
      "rmse_dy": 0.012945706024765968,
      "rmse_mean": 0.028523584827780724,
      "rotation_flip": 0.027927927672863007,
      "sparse_tokens": 18128.0,
      "step": 4205,
      "turn_loss": 0.23997028172016144,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.19540977513473332,
      "grad_norm": 0.6446904540061951,
      "learning_rate": 7.355525938927975e-06,
      "loss": 0.139,
      "mae_dtheta": 0.006253373809158802,
      "mae_dx": 0.001251949812285602,
      "mae_dy": 0.001231788657605648,
      "pose_mae_dtheta": 0.0448262058198452,
      "pose_mae_dx": 0.015348082408308983,
      "pose_mae_dy": 0.016004929319024086,
      "pose_rmse_dtheta": 0.12233778089284897,
      "pose_rmse_dx": 0.04275941103696823,
      "pose_rmse_dy": 0.04437263309955597,
      "pose_rmse_mean": 0.06982327997684479,
      "rmse_dtheta": 0.017010189592838287,
      "rmse_dx": 0.003826717147603631,
      "rmse_dy": 0.003234240924939513,
      "rmse_mean": 0.008023716509342194,
      "rotation_flip": 0.0029097963124513626,
      "sparse_tokens": 32121.0,
      "step": 4206,
      "turn_loss": 0.047082725912332535,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1954562349005761,
      "grad_norm": 0.7371119260787964,
      "learning_rate": 7.354359557445125e-06,
      "loss": 0.1251,
      "mae_dtheta": 0.011245849542319775,
      "mae_dx": 0.0029936698265373707,
      "mae_dy": 0.003980408888310194,
      "pose_mae_dtheta": 0.0853087529540062,
      "pose_mae_dx": 0.039972689002752304,
      "pose_mae_dy": 0.03771931678056717,
      "pose_rmse_dtheta": 0.21952645480632782,
      "pose_rmse_dx": 0.10825172811746597,
      "pose_rmse_dy": 0.1178753525018692,
      "pose_rmse_mean": 0.14855119585990906,
      "rmse_dtheta": 0.024625808000564575,
      "rmse_dx": 0.008226744830608368,
      "rmse_dy": 0.00894253235310316,
      "rmse_mean": 0.013931695371866226,
      "rotation_flip": 0.002644503256306052,
      "sparse_tokens": 32089.0,
      "step": 4207,
      "turn_loss": 0.11056087166070938,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.19550269466641887,
      "grad_norm": 0.4531030058860779,
      "learning_rate": 7.353193011320648e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.029671965166926384,
      "mae_dx": 0.010387753136456013,
      "mae_dy": 0.004364910069853067,
      "pose_mae_dtheta": 0.2220596820116043,
      "pose_mae_dx": 0.07448478788137436,
      "pose_mae_dy": 0.038650501519441605,
      "pose_rmse_dtheta": 0.4209566116333008,
      "pose_rmse_dx": 0.16424775123596191,
      "pose_rmse_dy": 0.07741203904151917,
      "pose_rmse_mean": 0.22087213397026062,
      "rmse_dtheta": 0.04696916416287422,
      "rmse_dx": 0.020727796480059624,
      "rmse_dy": 0.008787117898464203,
      "rmse_mean": 0.025494692847132683,
      "rotation_flip": 0.013745704665780067,
      "sparse_tokens": 9650.0,
      "step": 4208,
      "turn_loss": 0.24663662910461426,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 37963.0,
      "epoch": 0.19554915443226167,
      "grad_norm": 0.5558965802192688,
      "learning_rate": 7.352026300636121e-06,
      "loss": 0.1812,
      "mae_dtheta": 0.027646467089653015,
      "mae_dx": 0.00921288225799799,
      "mae_dy": 0.0053260005079209805,
      "pose_mae_dtheta": 0.20609727501869202,
      "pose_mae_dx": 0.08715058118104935,
      "pose_mae_dy": 0.07112583518028259,
      "pose_rmse_dtheta": 0.38054725527763367,
      "pose_rmse_dx": 0.19899234175682068,
      "pose_rmse_dy": 0.16213800013065338,
      "pose_rmse_mean": 0.24722586572170258,
      "rmse_dtheta": 0.044923149049282074,
      "rmse_dx": 0.020801017060875893,
      "rmse_dy": 0.011168199591338634,
      "rmse_mean": 0.025630787014961243,
      "rotation_flip": 0.014961101114749908,
      "sparse_tokens": 29863.0,
      "step": 4209,
      "turn_loss": 0.23198963701725006,
      "turns": 117.0,
      "turns_per_sample": 117.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.19559561419810445,
      "grad_norm": 0.5113741159439087,
      "learning_rate": 7.350859425473131e-06,
      "loss": 0.1318,
      "mae_dtheta": 0.025495057925581932,
      "mae_dx": 0.008062330074608326,
      "mae_dy": 0.0040714433416724205,
      "pose_mae_dtheta": 0.20264939963817596,
      "pose_mae_dx": 0.06417309492826462,
      "pose_mae_dy": 0.04684384539723396,
      "pose_rmse_dtheta": 0.4034956991672516,
      "pose_rmse_dx": 0.1679702252149582,
      "pose_rmse_dy": 0.11611028760671616,
      "pose_rmse_mean": 0.22919206321239471,
      "rmse_dtheta": 0.0428878590464592,
      "rmse_dx": 0.019640536978840828,
      "rmse_dy": 0.0093758013099432,
      "rmse_mean": 0.02396806702017784,
      "rotation_flip": 0.014625228941440582,
      "sparse_tokens": 19861.0,
      "step": 4210,
      "turn_loss": 0.20940211415290833,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.19564207396394723,
      "grad_norm": 0.6255791783332825,
      "learning_rate": 7.349692385913281e-06,
      "loss": 0.2029,
      "mae_dtheta": 0.02433522790670395,
      "mae_dx": 0.009050367400050163,
      "mae_dy": 0.002408725908026099,
      "pose_mae_dtheta": 0.19086018204689026,
      "pose_mae_dx": 0.0849066972732544,
      "pose_mae_dy": 0.027218256145715714,
      "pose_rmse_dtheta": 0.4104505181312561,
      "pose_rmse_dx": 0.22213219106197357,
      "pose_rmse_dy": 0.06008472293615341,
      "pose_rmse_mean": 0.23088914155960083,
      "rmse_dtheta": 0.04469870775938034,
      "rmse_dx": 0.02084672451019287,
      "rmse_dy": 0.004588731564581394,
      "rmse_mean": 0.023378055542707443,
      "rotation_flip": 0.002808988792821765,
      "sparse_tokens": 15307.0,
      "step": 4211,
      "turn_loss": 0.18288646638393402,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.19568853372979,
      "grad_norm": 0.7620998620986938,
      "learning_rate": 7.348525182038182e-06,
      "loss": 0.0904,
      "mae_dtheta": 0.0062974016182124615,
      "mae_dx": 0.0016423057531937957,
      "mae_dy": 0.0011106051970273256,
      "pose_mae_dtheta": 0.04594315588474274,
      "pose_mae_dx": 0.01809092052280903,
      "pose_mae_dy": 0.017197471112012863,
      "pose_rmse_dtheta": 0.09586343169212341,
      "pose_rmse_dx": 0.043194931000471115,
      "pose_rmse_dy": 0.04350503906607628,
      "pose_rmse_mean": 0.060854472219944,
      "rmse_dtheta": 0.014587869867682457,
      "rmse_dx": 0.0050601111724972725,
      "rmse_dy": 0.002411332679912448,
      "rmse_mean": 0.007353104650974274,
      "rotation_flip": 0.003882657503709197,
      "sparse_tokens": 32153.0,
      "step": 4212,
      "turn_loss": 0.04908435419201851,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.19573499349563278,
      "grad_norm": 0.6014999151229858,
      "learning_rate": 7.347357813929455e-06,
      "loss": 0.112,
      "mae_dtheta": 0.009344391524791718,
      "mae_dx": 0.0016222938429564238,
      "mae_dy": 0.0019880051258951426,
      "pose_mae_dtheta": 0.06947918236255646,
      "pose_mae_dx": 0.022905047982931137,
      "pose_mae_dy": 0.0299452543258667,
      "pose_rmse_dtheta": 0.1708589643239975,
      "pose_rmse_dx": 0.07223778963088989,
      "pose_rmse_dy": 0.0804639607667923,
      "pose_rmse_mean": 0.10785357654094696,
      "rmse_dtheta": 0.021272046491503716,
      "rmse_dx": 0.0063287122175097466,
      "rmse_dy": 0.004534848965704441,
      "rmse_mean": 0.010711869224905968,
      "rotation_flip": 0.002097535412758589,
      "sparse_tokens": 32041.0,
      "step": 4213,
      "turn_loss": 0.06826033443212509,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.19578145326147556,
      "grad_norm": 0.624224066734314,
      "learning_rate": 7.346190281668737e-06,
      "loss": 0.1568,
      "mae_dtheta": 0.04504812881350517,
      "mae_dx": 0.01907842792570591,
      "mae_dy": 0.00664193369448185,
      "pose_mae_dtheta": 0.37655121088027954,
      "pose_mae_dx": 0.14327962696552277,
      "pose_mae_dy": 0.11868607997894287,
      "pose_rmse_dtheta": 0.6023386716842651,
      "pose_rmse_dx": 0.28700709342956543,
      "pose_rmse_dy": 0.24417482316493988,
      "pose_rmse_mean": 0.37784022092819214,
      "rmse_dtheta": 0.06240571662783623,
      "rmse_dx": 0.033190567046403885,
      "rmse_dy": 0.010996559634804726,
      "rmse_mean": 0.035530947148799896,
      "rotation_flip": 0.01702786423265934,
      "sparse_tokens": 10845.0,
      "step": 4214,
      "turn_loss": 0.2604100704193115,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 8787.0,
      "epoch": 0.19582791302731833,
      "grad_norm": 0.6109434366226196,
      "learning_rate": 7.345022585337672e-06,
      "loss": 0.102,
      "mae_dtheta": 0.026174455881118774,
      "mae_dx": 0.01268777810037136,
      "mae_dy": 0.003317014081403613,
      "pose_mae_dtheta": 0.20827193558216095,
      "pose_mae_dx": 0.09451080113649368,
      "pose_mae_dy": 0.048628780990839005,
      "pose_rmse_dtheta": 0.4166678786277771,
      "pose_rmse_dx": 0.22519949078559875,
      "pose_rmse_dy": 0.13294629752635956,
      "pose_rmse_mean": 0.2582712471485138,
      "rmse_dtheta": 0.04455010965466499,
      "rmse_dx": 0.0262855663895607,
      "rmse_dy": 0.007191913668066263,
      "rmse_mean": 0.026009198278188705,
      "rotation_flip": 0.00958466436713934,
      "sparse_tokens": 6747.0,
      "step": 4215,
      "turn_loss": 0.19652433693408966,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.1958743727931611,
      "grad_norm": 0.5126689076423645,
      "learning_rate": 7.343854725017919e-06,
      "loss": 0.0964,
      "mae_dtheta": 0.010756813921034336,
      "mae_dx": 0.0017059675883501768,
      "mae_dy": 0.0021272324956953526,
      "pose_mae_dtheta": 0.07226427644491196,
      "pose_mae_dx": 0.02311609499156475,
      "pose_mae_dy": 0.03157304227352142,
      "pose_rmse_dtheta": 0.16105076670646667,
      "pose_rmse_dx": 0.07254758477210999,
      "pose_rmse_dy": 0.07205136120319366,
      "pose_rmse_mean": 0.10188323259353638,
      "rmse_dtheta": 0.02205469459295273,
      "rmse_dx": 0.007009923458099365,
      "rmse_dy": 0.004367640241980553,
      "rmse_mean": 0.011144086718559265,
      "rotation_flip": 0.004712939262390137,
      "sparse_tokens": 32041.0,
      "step": 4216,
      "turn_loss": 0.08059018105268478,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14943.0,
      "epoch": 0.19592083255900392,
      "grad_norm": 0.6484667062759399,
      "learning_rate": 7.342686700791149e-06,
      "loss": 0.0707,
      "mae_dtheta": 0.01881939359009266,
      "mae_dx": 0.007784054148942232,
      "mae_dy": 0.003157401690259576,
      "pose_mae_dtheta": 0.14212651550769806,
      "pose_mae_dx": 0.058915555477142334,
      "pose_mae_dy": 0.04177260771393776,
      "pose_rmse_dtheta": 0.2838117182254791,
      "pose_rmse_dx": 0.16517068445682526,
      "pose_rmse_dy": 0.098108671605587,
      "pose_rmse_mean": 0.18236368894577026,
      "rmse_dtheta": 0.03321732208132744,
      "rmse_dx": 0.020210495218634605,
      "rmse_dy": 0.00606786971911788,
      "rmse_mean": 0.01983189582824707,
      "rotation_flip": 0.012567324563860893,
      "sparse_tokens": 12494.0,
      "step": 4217,
      "turn_loss": 0.13052886724472046,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1959672923248467,
      "grad_norm": 0.8615628480911255,
      "learning_rate": 7.341518512739039e-06,
      "loss": 0.1353,
      "mae_dtheta": 0.01130661554634571,
      "mae_dx": 0.005000560078769922,
      "mae_dy": 0.005061526782810688,
      "pose_mae_dtheta": 0.0864410549402237,
      "pose_mae_dx": 0.053421564400196075,
      "pose_mae_dy": 0.037997547537088394,
      "pose_rmse_dtheta": 0.22671610116958618,
      "pose_rmse_dx": 0.15095242857933044,
      "pose_rmse_dy": 0.10738376528024673,
      "pose_rmse_mean": 0.1616840958595276,
      "rmse_dtheta": 0.025861792266368866,
      "rmse_dx": 0.013142887502908707,
      "rmse_dy": 0.012447601184248924,
      "rmse_mean": 0.01715075969696045,
      "rotation_flip": 0.00732758641242981,
      "sparse_tokens": 32121.0,
      "step": 4218,
      "turn_loss": 0.14494198560714722,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.19601375209068947,
      "grad_norm": 0.7090063095092773,
      "learning_rate": 7.3403501609432835e-06,
      "loss": 0.1901,
      "mae_dtheta": 0.00940614752471447,
      "mae_dx": 0.001930694910697639,
      "mae_dy": 0.0023346540983766317,
      "pose_mae_dtheta": 0.0635305866599083,
      "pose_mae_dx": 0.027461068704724312,
      "pose_mae_dy": 0.02829841524362564,
      "pose_rmse_dtheta": 0.12631672620773315,
      "pose_rmse_dx": 0.07481137663125992,
      "pose_rmse_dy": 0.06500183790922165,
      "pose_rmse_mean": 0.08870998024940491,
      "rmse_dtheta": 0.018054742366075516,
      "rmse_dx": 0.005917067173868418,
      "rmse_dy": 0.004922507796436548,
      "rmse_mean": 0.009631439112126827,
      "rotation_flip": 0.0027710425201803446,
      "sparse_tokens": 32121.0,
      "step": 4219,
      "turn_loss": 0.08127028495073318,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.19606021185653225,
      "grad_norm": 0.3200111389160156,
      "learning_rate": 7.339181645485585e-06,
      "loss": 0.0766,
      "mae_dtheta": 0.029574718326330185,
      "mae_dx": 0.013202172704041004,
      "mae_dy": 0.0035183383151888847,
      "pose_mae_dtheta": 0.2389010637998581,
      "pose_mae_dx": 0.0922188013792038,
      "pose_mae_dy": 0.05281196907162666,
      "pose_rmse_dtheta": 0.45534297823905945,
      "pose_rmse_dx": 0.20274458825588226,
      "pose_rmse_dy": 0.1506035029888153,
      "pose_rmse_mean": 0.2695636749267578,
      "rmse_dtheta": 0.04811310023069382,
      "rmse_dx": 0.026972578838467598,
      "rmse_dy": 0.006944212131202221,
      "rmse_mean": 0.027343295514583588,
      "rotation_flip": 0.008823529817163944,
      "sparse_tokens": 5951.0,
      "step": 4220,
      "turn_loss": 0.17367954552173615,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.19610667162237502,
      "grad_norm": 0.49913913011550903,
      "learning_rate": 7.3380129664476574e-06,
      "loss": 0.1354,
      "mae_dtheta": 0.010213292203843594,
      "mae_dx": 0.0010843020863831043,
      "mae_dy": 0.00176224485039711,
      "pose_mae_dtheta": 0.06846775114536285,
      "pose_mae_dx": 0.01588263548910618,
      "pose_mae_dy": 0.026883617043495178,
      "pose_rmse_dtheta": 0.19893130660057068,
      "pose_rmse_dx": 0.04152267426252365,
      "pose_rmse_dy": 0.07763999700546265,
      "pose_rmse_mean": 0.10603132843971252,
      "rmse_dtheta": 0.024319205433130264,
      "rmse_dx": 0.003371173981577158,
      "rmse_dy": 0.00400483189150691,
      "rmse_mean": 0.010565070435404778,
      "rotation_flip": 0.002676181960850954,
      "sparse_tokens": 32073.0,
      "step": 4221,
      "turn_loss": 0.07000456750392914,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.1961531313882178,
      "grad_norm": 0.5407798290252686,
      "learning_rate": 7.336844123911229e-06,
      "loss": 0.0779,
      "mae_dtheta": 0.008275835774838924,
      "mae_dx": 0.0017520601395517588,
      "mae_dy": 0.0020760076586157084,
      "pose_mae_dtheta": 0.06054544821381569,
      "pose_mae_dx": 0.022681087255477905,
      "pose_mae_dy": 0.026067959144711494,
      "pose_rmse_dtheta": 0.15070459246635437,
      "pose_rmse_dx": 0.056681737303733826,
      "pose_rmse_dy": 0.06756404042243958,
      "pose_rmse_mean": 0.09165012836456299,
      "rmse_dtheta": 0.019941285252571106,
      "rmse_dx": 0.005048288498073816,
      "rmse_dy": 0.004908544011414051,
      "rmse_mean": 0.009966040030121803,
      "rotation_flip": 0.0034992224536836147,
      "sparse_tokens": 32137.0,
      "step": 4222,
      "turn_loss": 0.07318215072154999,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.19619959115406058,
      "grad_norm": 1.010230302810669,
      "learning_rate": 7.335675117958037e-06,
      "loss": 0.3309,
      "mae_dtheta": 0.04990820586681366,
      "mae_dx": 0.017620204016566277,
      "mae_dy": 0.008369059301912785,
      "pose_mae_dtheta": 0.45526960492134094,
      "pose_mae_dx": 0.16042421758174896,
      "pose_mae_dy": 0.09275399893522263,
      "pose_rmse_dtheta": 0.6863451600074768,
      "pose_rmse_dx": 0.2961180508136749,
      "pose_rmse_dy": 0.18891878426074982,
      "pose_rmse_mean": 0.39046069979667664,
      "rmse_dtheta": 0.06961344182491302,
      "rmse_dx": 0.030335942283272743,
      "rmse_dy": 0.016117887571454048,
      "rmse_mean": 0.03868909180164337,
      "rotation_flip": 0.031128404662013054,
      "sparse_tokens": 12668.0,
      "step": 4223,
      "turn_loss": 0.48924264311790466,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.19624605091990335,
      "grad_norm": 1.3936522006988525,
      "learning_rate": 7.33450594866983e-06,
      "loss": 0.2484,
      "mae_dtheta": 0.021575016900897026,
      "mae_dx": 0.005533578339964151,
      "mae_dy": 0.0035017039626836777,
      "pose_mae_dtheta": 0.1529393196105957,
      "pose_mae_dx": 0.04857756569981575,
      "pose_mae_dy": 0.04610414803028107,
      "pose_rmse_dtheta": 0.33794474601745605,
      "pose_rmse_dx": 0.1291818767786026,
      "pose_rmse_dy": 0.10764757543802261,
      "pose_rmse_mean": 0.19159141182899475,
      "rmse_dtheta": 0.039155952632427216,
      "rmse_dx": 0.01541722659021616,
      "rmse_dy": 0.007360696792602539,
      "rmse_mean": 0.020644625648856163,
      "rotation_flip": 0.011887072585523129,
      "sparse_tokens": 12646.0,
      "step": 4224,
      "turn_loss": 0.13822223246097565,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.19629251068574616,
      "grad_norm": 0.5092654228210449,
      "learning_rate": 7.333336616128369e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.034169092774391174,
      "mae_dx": 0.011340486817061901,
      "mae_dy": 0.003950957208871841,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5092654228210449,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.4987030029297,
      "model/head/act_norm_mean": 109.7237215909091,
      "model/head/act_norm_min": 81.59837341308594,
      "model/head/act_over_embed": 75.40316872693884,
      "model/head/grad_frac": 0.1063324362039566,
      "model/head/grad_norm": 0.05415143445134163,
      "model/head/grad_zero_frac": 0.000163394957780838,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6896129261363636,
      "model/head/update_ratio": 0.0009298431104980409,
      "model/head/weight_delta": 7.670687675476074,
      "model/head/weight_delta_rel": 0.13456657528877258,
      "model/head/weight_norm": 58.23717498779297,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41795551776885986,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41795551776885986,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41795551776885986,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2872229447719676,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0977780818939209,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0497949980199337,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001612395979464054,
      "model/modality_embedder.encoders.pose/weight_delta": 2.5138144493103027,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08213414996862411,
      "model/modality_embedder.encoders.pose/weight_norm": 30.882612228393555,
      "model/modality_embedder/grad_frac": 0.0977780818939209,
      "model/modality_embedder/grad_norm": 0.0497949980199337,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.001612395979464054,
      "model/modality_embedder/weight_delta": 2.5138144493103027,
      "model/modality_embedder/weight_delta_rel": 0.08213414996862411,
      "model/modality_embedder/weight_norm": 30.882612228393555,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.84773254394531,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.591829004329004,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.269209861755371,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.212525761957895,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08525287359952927,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0434163399040699,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001563822734169662,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.818619966506958,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06627161055803299,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.762954711914062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.48441314697266,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.409695165945166,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.732799530029297,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.774571045204166,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08547575771808624,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.043529849499464035,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014784825034439564,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.299503803253174,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07965660840272903,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.442249298095703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.21548461914062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.02405753968254,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.110928535461426,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.883975982335155,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08621633052825928,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04390699416399002,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014445651322603226,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.4693875312805176,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08291740715503693,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.394609451293945,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.01172637939453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.952157738095238,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.533693313598633,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.20898448984282,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09412246197462082,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04793331399559975,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016138931969180703,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.1090457439422607,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.072077177464962,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.700424194335938,
      "model/normalizer/grad_frac": 0.4051918089389801,
      "model/normalizer/grad_norm": 0.206350177526474,
      "model/normalizer/grad_zero_frac": 0.00018080597510561347,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0026357192546129227,
      "model/normalizer/weight_delta": 4.47734260559082,
      "model/normalizer/weight_delta_rel": 0.05766557902097702,
      "model/normalizer/weight_norm": 78.2898941040039,
      "pose_mae_dtheta": 0.27643299102783203,
      "pose_mae_dx": 0.0903695598244667,
      "pose_mae_dy": 0.04838119074702263,
      "pose_rmse_dtheta": 0.4983845353126526,
      "pose_rmse_dx": 0.19338224828243256,
      "pose_rmse_dy": 0.1309235692024231,
      "pose_rmse_mean": 0.27423012256622314,
      "rmse_dtheta": 0.05288723111152649,
      "rmse_dx": 0.023098677396774292,
      "rmse_dy": 0.008619830943644047,
      "rmse_mean": 0.028201913461089134,
      "rotation_flip": 0.01101591158658266,
      "sparse_tokens": 13346.0,
      "step": 4225,
      "turn_loss": 0.24619635939598083,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.19633897045158893,
      "grad_norm": 0.6473013758659363,
      "learning_rate": 7.3321671204154265e-06,
      "loss": 0.1624,
      "mae_dtheta": 0.028391897678375244,
      "mae_dx": 0.022378241643309593,
      "mae_dy": 0.010934757068753242,
      "pose_mae_dtheta": 0.22035115957260132,
      "pose_mae_dx": 0.1599026620388031,
      "pose_mae_dy": 0.09285026788711548,
      "pose_rmse_dtheta": 0.3580549657344818,
      "pose_rmse_dx": 0.3178184926509857,
      "pose_rmse_dy": 0.16606847941875458,
      "pose_rmse_mean": 0.280647337436676,
      "rmse_dtheta": 0.04381990060210228,
      "rmse_dx": 0.034675054252147675,
      "rmse_dy": 0.01856287568807602,
      "rmse_mean": 0.03235261142253876,
      "rotation_flip": 0.005025125574320555,
      "sparse_tokens": 4042.0,
      "step": 4226,
      "turn_loss": 0.5561088919639587,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 1336.0,
      "epoch": 0.1963854302174317,
      "grad_norm": 0.6658164262771606,
      "learning_rate": 7.330997461612786e-06,
      "loss": 0.1515,
      "mae_dtheta": 0.051510028541088104,
      "mae_dx": 0.0407915897667408,
      "mae_dy": 0.014623838476836681,
      "pose_mae_dtheta": 0.4556649327278137,
      "pose_mae_dx": 0.28198331594467163,
      "pose_mae_dy": 0.26111486554145813,
      "pose_rmse_dtheta": 0.5392848253250122,
      "pose_rmse_dx": 0.4150959849357605,
      "pose_rmse_dy": 0.3380565643310547,
      "pose_rmse_mean": 0.43081244826316833,
      "rmse_dtheta": 0.06368764489889145,
      "rmse_dx": 0.05124697834253311,
      "rmse_dy": 0.01818348839879036,
      "rmse_mean": 0.04437270388007164,
      "rotation_flip": 0.0,
      "sparse_tokens": 1176.0,
      "step": 4227,
      "turn_loss": 0.971091628074646,
      "turns": 4.0,
      "turns_per_sample": 4.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1964318899832745,
      "grad_norm": 0.5068108439445496,
      "learning_rate": 7.329827639802241e-06,
      "loss": 0.1006,
      "mae_dtheta": 0.009160141460597515,
      "mae_dx": 0.0017825645627453923,
      "mae_dy": 0.0017292137490585446,
      "pose_mae_dtheta": 0.05883827060461044,
      "pose_mae_dx": 0.01765897311270237,
      "pose_mae_dy": 0.020945612341165543,
      "pose_rmse_dtheta": 0.1549568921327591,
      "pose_rmse_dx": 0.04671531915664673,
      "pose_rmse_dy": 0.05071619525551796,
      "pose_rmse_mean": 0.08412947505712509,
      "rmse_dtheta": 0.022833388298749924,
      "rmse_dx": 0.004841893445700407,
      "rmse_dy": 0.004900909960269928,
      "rmse_mean": 0.010858731344342232,
      "rotation_flip": 0.002037697471678257,
      "sparse_tokens": 32089.0,
      "step": 4228,
      "turn_loss": 0.08873219043016434,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.19647834974911726,
      "grad_norm": 0.9772912859916687,
      "learning_rate": 7.328657655065598e-06,
      "loss": 0.1506,
      "mae_dtheta": 0.028460398316383362,
      "mae_dx": 0.013506300747394562,
      "mae_dy": 0.0034913644194602966,
      "pose_mae_dtheta": 0.21939076483249664,
      "pose_mae_dx": 0.11040706932544708,
      "pose_mae_dy": 0.0395500585436821,
      "pose_rmse_dtheta": 0.35446619987487793,
      "pose_rmse_dx": 0.2454202026128769,
      "pose_rmse_dy": 0.0882411077618599,
      "pose_rmse_mean": 0.22937583923339844,
      "rmse_dtheta": 0.04156075417995453,
      "rmse_dx": 0.026126231998205185,
      "rmse_dy": 0.005926518235355616,
      "rmse_mean": 0.024537837132811546,
      "rotation_flip": 0.013853903859853745,
      "sparse_tokens": 12961.0,
      "step": 4229,
      "turn_loss": 0.25859835743904114,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19652480951496004,
      "grad_norm": 0.4986362159252167,
      "learning_rate": 7.327487507484676e-06,
      "loss": 0.1099,
      "mae_dtheta": 0.01619706116616726,
      "mae_dx": 0.006389614660292864,
      "mae_dy": 0.00680095050483942,
      "pose_mae_dtheta": 0.12013722211122513,
      "pose_mae_dx": 0.08103366941213608,
      "pose_mae_dy": 0.07080584764480591,
      "pose_rmse_dtheta": 0.25551149249076843,
      "pose_rmse_dx": 0.19344854354858398,
      "pose_rmse_dy": 0.1625395268201828,
      "pose_rmse_mean": 0.2038331925868988,
      "rmse_dtheta": 0.029925523325800896,
      "rmse_dx": 0.01646924577653408,
      "rmse_dy": 0.0139847407117486,
      "rmse_mean": 0.020126502960920334,
      "rotation_flip": 0.012265757657587528,
      "sparse_tokens": 32105.0,
      "step": 4230,
      "turn_loss": 0.19091731309890747,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.19657126928080282,
      "grad_norm": 0.4028603136539459,
      "learning_rate": 7.326317197141304e-06,
      "loss": 0.1095,
      "mae_dtheta": 0.030708011239767075,
      "mae_dx": 0.01685267686843872,
      "mae_dy": 0.007418208755552769,
      "pose_mae_dtheta": 0.23879294097423553,
      "pose_mae_dx": 0.1250973641872406,
      "pose_mae_dy": 0.08435621857643127,
      "pose_rmse_dtheta": 0.41612425446510315,
      "pose_rmse_dx": 0.2726023197174072,
      "pose_rmse_dy": 0.16451597213745117,
      "pose_rmse_mean": 0.2844141721725464,
      "rmse_dtheta": 0.0454707108438015,
      "rmse_dx": 0.030506232753396034,
      "rmse_dy": 0.012305625714361668,
      "rmse_mean": 0.029427524656057358,
      "rotation_flip": 0.011261261068284512,
      "sparse_tokens": 15528.0,
      "step": 4231,
      "turn_loss": 0.3481946289539337,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1966177290466456,
      "grad_norm": 0.6610622406005859,
      "learning_rate": 7.32514672411732e-06,
      "loss": 0.1221,
      "mae_dtheta": 0.011127321980893612,
      "mae_dx": 0.002597917104139924,
      "mae_dy": 0.002698049647733569,
      "pose_mae_dtheta": 0.07581261545419693,
      "pose_mae_dx": 0.03350623697042465,
      "pose_mae_dy": 0.03330150991678238,
      "pose_rmse_dtheta": 0.1787758469581604,
      "pose_rmse_dx": 0.07887253165245056,
      "pose_rmse_dy": 0.08199691027402878,
      "pose_rmse_mean": 0.11321510374546051,
      "rmse_dtheta": 0.024559032171964645,
      "rmse_dx": 0.007323595695197582,
      "rmse_dy": 0.006101721432060003,
      "rmse_mean": 0.012661449611186981,
      "rotation_flip": 0.0029250457882881165,
      "sparse_tokens": 32105.0,
      "step": 4232,
      "turn_loss": 0.13027408719062805,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.19666418881248837,
      "grad_norm": 0.5914202332496643,
      "learning_rate": 7.32397608849458e-06,
      "loss": 0.1382,
      "mae_dtheta": 0.03333039581775665,
      "mae_dx": 0.012651799246668816,
      "mae_dy": 0.004385713487863541,
      "pose_mae_dtheta": 0.2828229069709778,
      "pose_mae_dx": 0.1023709625005722,
      "pose_mae_dy": 0.07830919325351715,
      "pose_rmse_dtheta": 0.4855780303478241,
      "pose_rmse_dx": 0.2272949069738388,
      "pose_rmse_dy": 0.14696632325649261,
      "pose_rmse_mean": 0.2866131067276001,
      "rmse_dtheta": 0.050187963992357254,
      "rmse_dx": 0.026236578822135925,
      "rmse_dy": 0.007625963073223829,
      "rmse_mean": 0.02801683358848095,
      "rotation_flip": 0.011703510768711567,
      "sparse_tokens": 15345.0,
      "step": 4233,
      "turn_loss": 0.23905272781848907,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19671064857833118,
      "grad_norm": 0.5889939665794373,
      "learning_rate": 7.322805290354943e-06,
      "loss": 0.0919,
      "mae_dtheta": 0.01017783209681511,
      "mae_dx": 0.001609594328328967,
      "mae_dy": 0.002643209183588624,
      "pose_mae_dtheta": 0.06936532258987427,
      "pose_mae_dx": 0.02406405657529831,
      "pose_mae_dy": 0.03239460289478302,
      "pose_rmse_dtheta": 0.1537327617406845,
      "pose_rmse_dx": 0.06373506784439087,
      "pose_rmse_dy": 0.08713597804307938,
      "pose_rmse_mean": 0.10153460502624512,
      "rmse_dtheta": 0.021336285397410393,
      "rmse_dx": 0.004379273857921362,
      "rmse_dy": 0.005713620688766241,
      "rmse_mean": 0.01047639362514019,
      "rotation_flip": 0.005488044116646051,
      "sparse_tokens": 32089.0,
      "step": 4234,
      "turn_loss": 0.09687045961618423,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.19675710834417395,
      "grad_norm": 0.41045576333999634,
      "learning_rate": 7.321634329780286e-06,
      "loss": 0.0853,
      "mae_dtheta": 0.0309444610029459,
      "mae_dx": 0.009228551760315895,
      "mae_dy": 0.006140155252069235,
      "pose_mae_dtheta": 0.2107144296169281,
      "pose_mae_dx": 0.08362040668725967,
      "pose_mae_dy": 0.09116242080926895,
      "pose_rmse_dtheta": 0.3249441087245941,
      "pose_rmse_dx": 0.2000149041414261,
      "pose_rmse_dy": 0.1702880561351776,
      "pose_rmse_mean": 0.231749027967453,
      "rmse_dtheta": 0.04331692308187485,
      "rmse_dx": 0.021868078038096428,
      "rmse_dy": 0.009644447825849056,
      "rmse_mean": 0.024943150579929352,
      "rotation_flip": 0.007915567606687546,
      "sparse_tokens": 6971.0,
      "step": 4235,
      "turn_loss": 0.22435416281223297,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.19680356811001673,
      "grad_norm": 0.46149003505706787,
      "learning_rate": 7.320463206852493e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.009202491492033005,
      "mae_dx": 0.0015934229595586658,
      "mae_dy": 0.002181884367018938,
      "pose_mae_dtheta": 0.0637970119714737,
      "pose_mae_dx": 0.025130445137619972,
      "pose_mae_dy": 0.028726989403367043,
      "pose_rmse_dtheta": 0.12583503127098083,
      "pose_rmse_dx": 0.0783194825053215,
      "pose_rmse_dy": 0.06778613477945328,
      "pose_rmse_mean": 0.0906468853354454,
      "rmse_dtheta": 0.017606325447559357,
      "rmse_dx": 0.005060082767158747,
      "rmse_dy": 0.005167417228221893,
      "rmse_mean": 0.009277941659092903,
      "rotation_flip": 0.002726918552070856,
      "sparse_tokens": 32057.0,
      "step": 4236,
      "turn_loss": 0.06635100394487381,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1968500278758595,
      "grad_norm": 0.5194096565246582,
      "learning_rate": 7.319291921653464e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.008652000688016415,
      "mae_dx": 0.0018191130366176367,
      "mae_dy": 0.0016485522501170635,
      "pose_mae_dtheta": 0.05825503170490265,
      "pose_mae_dx": 0.022409996017813683,
      "pose_mae_dy": 0.02130237966775894,
      "pose_rmse_dtheta": 0.16700752079486847,
      "pose_rmse_dx": 0.060445237904787064,
      "pose_rmse_dy": 0.05345459654927254,
      "pose_rmse_mean": 0.09363579005002975,
      "rmse_dtheta": 0.021253427490592003,
      "rmse_dx": 0.005786172579973936,
      "rmse_dy": 0.004045874811708927,
      "rmse_mean": 0.010361826047301292,
      "rotation_flip": 0.0013953488087281585,
      "sparse_tokens": 32073.0,
      "step": 4237,
      "turn_loss": 0.08187969028949738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.19689648764170228,
      "grad_norm": 0.7314767241477966,
      "learning_rate": 7.318120474265106e-06,
      "loss": 0.1705,
      "mae_dtheta": 0.025211242958903313,
      "mae_dx": 0.013060922734439373,
      "mae_dy": 0.0037836285773664713,
      "pose_mae_dtheta": 0.19894763827323914,
      "pose_mae_dx": 0.10550904273986816,
      "pose_mae_dy": 0.05166826769709587,
      "pose_rmse_dtheta": 0.3920207619667053,
      "pose_rmse_dx": 0.25412923097610474,
      "pose_rmse_dy": 0.1541854590177536,
      "pose_rmse_mean": 0.26677849888801575,
      "rmse_dtheta": 0.042648207396268845,
      "rmse_dx": 0.02713152766227722,
      "rmse_dy": 0.007752700708806515,
      "rmse_mean": 0.0258441474288702,
      "rotation_flip": 0.010089686140418053,
      "sparse_tokens": 19260.0,
      "step": 4238,
      "turn_loss": 0.21697461605072021,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 30400.0,
      "epoch": 0.19694294740754506,
      "grad_norm": 0.46843886375427246,
      "learning_rate": 7.3169488647693384e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.04056592658162117,
      "mae_dx": 0.01664305478334427,
      "mae_dy": 0.006816335953772068,
      "pose_mae_dtheta": 0.3170405626296997,
      "pose_mae_dx": 0.12421456724405289,
      "pose_mae_dy": 0.07882656157016754,
      "pose_rmse_dtheta": 0.5342904329299927,
      "pose_rmse_dx": 0.2526121437549591,
      "pose_rmse_dy": 0.1841387003660202,
      "pose_rmse_mean": 0.32368043065071106,
      "rmse_dtheta": 0.058215782046318054,
      "rmse_dx": 0.029879823327064514,
      "rmse_dy": 0.012703817337751389,
      "rmse_mean": 0.03359980881214142,
      "rotation_flip": 0.01589404046535492,
      "sparse_tokens": 24291.0,
      "step": 4239,
      "turn_loss": 0.34244099259376526,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.19698940717338784,
      "grad_norm": 0.783154308795929,
      "learning_rate": 7.3157770932480935e-06,
      "loss": 0.1253,
      "mae_dtheta": 0.008971331641077995,
      "mae_dx": 0.0017567150061950088,
      "mae_dy": 0.00208650017157197,
      "pose_mae_dtheta": 0.05983567610383034,
      "pose_mae_dx": 0.02232900820672512,
      "pose_mae_dy": 0.024540908634662628,
      "pose_rmse_dtheta": 0.1381833702325821,
      "pose_rmse_dx": 0.06590764969587326,
      "pose_rmse_dy": 0.05794001370668411,
      "pose_rmse_mean": 0.08734367787837982,
      "rmse_dtheta": 0.01883295364677906,
      "rmse_dx": 0.006154473405331373,
      "rmse_dy": 0.004727237857878208,
      "rmse_mean": 0.009904889389872551,
      "rotation_flip": 0.003082342678681016,
      "sparse_tokens": 32057.0,
      "step": 4240,
      "turn_loss": 0.07109507918357849,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.19703586693923061,
      "grad_norm": 0.4248303771018982,
      "learning_rate": 7.314605159783313e-06,
      "loss": 0.0685,
      "mae_dtheta": 0.008632756769657135,
      "mae_dx": 0.0014352129073813558,
      "mae_dy": 0.0016214655479416251,
      "pose_mae_dtheta": 0.061408631503582,
      "pose_mae_dx": 0.01836443319916725,
      "pose_mae_dy": 0.02477688528597355,
      "pose_rmse_dtheta": 0.15392330288887024,
      "pose_rmse_dx": 0.05127495527267456,
      "pose_rmse_dy": 0.05710085108876228,
      "pose_rmse_mean": 0.08743304014205933,
      "rmse_dtheta": 0.02093285508453846,
      "rmse_dx": 0.005160497035831213,
      "rmse_dy": 0.0033374803606420755,
      "rmse_mean": 0.009810278192162514,
      "rotation_flip": 0.0029112081974744797,
      "sparse_tokens": 32057.0,
      "step": 4241,
      "turn_loss": 0.057777319103479385,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.19708232670507342,
      "grad_norm": 0.46264874935150146,
      "learning_rate": 7.313433064456952e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.010157152079045773,
      "mae_dx": 0.0024224044755101204,
      "mae_dy": 0.002741344505921006,
      "pose_mae_dtheta": 0.06941970437765121,
      "pose_mae_dx": 0.025915248319506645,
      "pose_mae_dy": 0.026013027876615524,
      "pose_rmse_dtheta": 0.16534876823425293,
      "pose_rmse_dx": 0.06577993184328079,
      "pose_rmse_dy": 0.05707312002778053,
      "pose_rmse_mean": 0.09606727212667465,
      "rmse_dtheta": 0.023344136774539948,
      "rmse_dx": 0.00723939249292016,
      "rmse_dy": 0.007205307949334383,
      "rmse_mean": 0.012596279382705688,
      "rotation_flip": 0.004179331474006176,
      "sparse_tokens": 32121.0,
      "step": 4242,
      "turn_loss": 0.08753838390111923,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1971287864709162,
      "grad_norm": 0.4719988703727722,
      "learning_rate": 7.312260807350975e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.008054762147367,
      "mae_dx": 0.001577058807015419,
      "mae_dy": 0.0011364070232957602,
      "pose_mae_dtheta": 0.053671807050704956,
      "pose_mae_dx": 0.017957326024770737,
      "pose_mae_dy": 0.017546437680721283,
      "pose_rmse_dtheta": 0.1677398979663849,
      "pose_rmse_dx": 0.05391348525881767,
      "pose_rmse_dy": 0.05113084241747856,
      "pose_rmse_mean": 0.0909280776977539,
      "rmse_dtheta": 0.02203509956598282,
      "rmse_dx": 0.005712359678000212,
      "rmse_dy": 0.002789905993267894,
      "rmse_mean": 0.010179121978580952,
      "rotation_flip": 0.0028121485374867916,
      "sparse_tokens": 32073.0,
      "step": 4243,
      "turn_loss": 0.05490902066230774,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.19717524623675897,
      "grad_norm": 0.5921310782432556,
      "learning_rate": 7.311088388547359e-06,
      "loss": 0.1464,
      "mae_dtheta": 0.031098244711756706,
      "mae_dx": 0.011575696058571339,
      "mae_dy": 0.004845181480050087,
      "pose_mae_dtheta": 0.2498237043619156,
      "pose_mae_dx": 0.09667634963989258,
      "pose_mae_dy": 0.06181575730443001,
      "pose_rmse_dtheta": 0.4303687810897827,
      "pose_rmse_dx": 0.22854478657245636,
      "pose_rmse_dy": 0.13928420841693878,
      "pose_rmse_mean": 0.26606592535972595,
      "rmse_dtheta": 0.04683013632893562,
      "rmse_dx": 0.023997126147150993,
      "rmse_dy": 0.008690684102475643,
      "rmse_mean": 0.026505982503294945,
      "rotation_flip": 0.01610904559493065,
      "sparse_tokens": 15532.0,
      "step": 4244,
      "turn_loss": 0.3123463988304138,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.19722170600260175,
      "grad_norm": 0.54386305809021,
      "learning_rate": 7.309915808128091e-06,
      "loss": 0.2213,
      "mae_dtheta": 0.03197920694947243,
      "mae_dx": 0.010953990742564201,
      "mae_dy": 0.003294828347861767,
      "pose_mae_dtheta": 0.2623821794986725,
      "pose_mae_dx": 0.08693418651819229,
      "pose_mae_dy": 0.040944717824459076,
      "pose_rmse_dtheta": 0.43580716848373413,
      "pose_rmse_dx": 0.18395185470581055,
      "pose_rmse_dy": 0.10238555818796158,
      "pose_rmse_mean": 0.2407148778438568,
      "rmse_dtheta": 0.04921223223209381,
      "rmse_dx": 0.02282886393368244,
      "rmse_dy": 0.006915716920047998,
      "rmse_mean": 0.02631893754005432,
      "rotation_flip": 0.02048417180776596,
      "sparse_tokens": 9034.0,
      "step": 4245,
      "turn_loss": 0.2419382780790329,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.19726816576844453,
      "grad_norm": 0.6422028541564941,
      "learning_rate": 7.308743066175172e-06,
      "loss": 0.1385,
      "mae_dtheta": 0.03395240381360054,
      "mae_dx": 0.017012853175401688,
      "mae_dy": 0.005191098432987928,
      "pose_mae_dtheta": 0.2805311977863312,
      "pose_mae_dx": 0.1404023915529251,
      "pose_mae_dy": 0.07515312731266022,
      "pose_rmse_dtheta": 0.5054412484169006,
      "pose_rmse_dx": 0.30250874161720276,
      "pose_rmse_dy": 0.15901973843574524,
      "pose_rmse_mean": 0.3223232626914978,
      "rmse_dtheta": 0.05241695046424866,
      "rmse_dx": 0.03162368759512901,
      "rmse_dy": 0.01147216372191906,
      "rmse_mean": 0.03183760493993759,
      "rotation_flip": 0.011058451607823372,
      "sparse_tokens": 23644.0,
      "step": 4246,
      "turn_loss": 0.2978765666484833,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1973146255342873,
      "grad_norm": 0.5653379559516907,
      "learning_rate": 7.3075701627706095e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.00879539456218481,
      "mae_dx": 0.0017785074887797236,
      "mae_dy": 0.001528813154436648,
      "pose_mae_dtheta": 0.06236894801259041,
      "pose_mae_dx": 0.022766519337892532,
      "pose_mae_dy": 0.018905412405729294,
      "pose_rmse_dtheta": 0.18766522407531738,
      "pose_rmse_dx": 0.05758729204535484,
      "pose_rmse_dy": 0.05158506706357002,
      "pose_rmse_mean": 0.09894587099552155,
      "rmse_dtheta": 0.024295413866639137,
      "rmse_dx": 0.004970218520611525,
      "rmse_dy": 0.004098095931112766,
      "rmse_mean": 0.011121243238449097,
      "rotation_flip": 0.0005010020104236901,
      "sparse_tokens": 32105.0,
      "step": 4247,
      "turn_loss": 0.06632870435714722,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.19736108530013008,
      "grad_norm": 0.6647031307220459,
      "learning_rate": 7.306397097996426e-06,
      "loss": 0.124,
      "mae_dtheta": 0.012214605696499348,
      "mae_dx": 0.0023563136346638203,
      "mae_dy": 0.002489995677024126,
      "pose_mae_dtheta": 0.09207157045602798,
      "pose_mae_dx": 0.024555964395403862,
      "pose_mae_dy": 0.03202509880065918,
      "pose_rmse_dtheta": 0.25202664732933044,
      "pose_rmse_dx": 0.06368070095777512,
      "pose_rmse_dy": 0.0991985872387886,
      "pose_rmse_mean": 0.13830198347568512,
      "rmse_dtheta": 0.027515897527337074,
      "rmse_dx": 0.007104261312633753,
      "rmse_dy": 0.006013845559209585,
      "rmse_mean": 0.013544667512178421,
      "rotation_flip": 0.0033136967103928328,
      "sparse_tokens": 32169.0,
      "step": 4248,
      "turn_loss": 0.09600859880447388,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.19740754506597286,
      "grad_norm": 0.4457375109195709,
      "learning_rate": 7.305223871934657e-06,
      "loss": 0.1032,
      "mae_dtheta": 0.011097464710474014,
      "mae_dx": 0.0034725426230579615,
      "mae_dy": 0.003099946305155754,
      "pose_mae_dtheta": 0.08609360456466675,
      "pose_mae_dx": 0.03201892226934433,
      "pose_mae_dy": 0.026860017329454422,
      "pose_rmse_dtheta": 0.23891547322273254,
      "pose_rmse_dx": 0.10106506198644638,
      "pose_rmse_dy": 0.10004830360412598,
      "pose_rmse_mean": 0.14667628705501556,
      "rmse_dtheta": 0.02938767336308956,
      "rmse_dx": 0.00950939767062664,
      "rmse_dy": 0.010794480331242085,
      "rmse_mean": 0.01656385138630867,
      "rotation_flip": 0.007313505746424198,
      "sparse_tokens": 32201.0,
      "step": 4249,
      "turn_loss": 0.13175587356090546,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19745400483181566,
      "grad_norm": 0.5505072474479675,
      "learning_rate": 7.3040504846673455e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.010806165635585785,
      "mae_dx": 0.002420556964352727,
      "mae_dy": 0.003312690183520317,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5505071878433228,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.12277221679688,
      "model/head/act_norm_mean": 113.80784406565657,
      "model/head/act_norm_min": 53.45062255859375,
      "model/head/act_over_embed": 78.20981592774234,
      "model/head/grad_frac": 0.10271526128053665,
      "model/head/grad_norm": 0.05654548853635788,
      "model/head/grad_zero_frac": 0.0001621258707018569,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6982027304292929,
      "model/head/update_ratio": 0.0009708557045087218,
      "model/head/weight_delta": 7.689374923706055,
      "model/head/weight_delta_rel": 0.13489441573619843,
      "model/head/weight_norm": 58.24293899536133,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41813769936561584,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41806489417995263,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41794273257255554,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2872981092656686,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1254138946533203,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06904125213623047,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5430836397058824,
      "model/modality_embedder.encoders.pose/update_ratio": 0.00223552412353456,
      "model/modality_embedder.encoders.pose/weight_delta": 2.5269062519073486,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0825619027018547,
      "model/modality_embedder.encoders.pose/weight_norm": 30.883697509765625,
      "model/modality_embedder/grad_frac": 0.1254138946533203,
      "model/modality_embedder/grad_norm": 0.06904125213623047,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5430836397058824,
      "model/modality_embedder/update_ratio": 0.00223552412353456,
      "model/modality_embedder/weight_delta": 2.5269062519073486,
      "model/modality_embedder/weight_delta_rel": 0.0825619027018547,
      "model/modality_embedder/weight_norm": 30.883697509765625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.2054672241211,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.992078523328523,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.027429580688477,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.4875809786094,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0648672804236412,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03570990264415741,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012861774303019047,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.825776219367981,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06653238832950592,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.764366149902344,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.07556915283203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.02266464245631,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.294715881347656,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.19580940817328,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06463875621557236,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03558409959077835,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012084799818694592,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.309030771255493,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.07998663187026978,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.445337295532227,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.0079345703125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.934736752445087,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.712328910827637,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.509803263258696,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06472231447696686,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03563009947538376,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011721241753548384,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.4794375896453857,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.083254873752594,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.39788818359375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.7796859741211,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.801842833092834,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.644231796264648,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.792896042002358,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06695477664470673,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03685908392071724,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012409617193043232,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.1172685623168945,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07235819101333618,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.7020320892334,
      "model/normalizer/grad_frac": 0.24865207076072693,
      "model/normalizer/grad_norm": 0.13688474893569946,
      "model/normalizer/grad_zero_frac": 0.00020444074471015483,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017483622068539262,
      "model/normalizer/weight_delta": 4.495514869689941,
      "model/normalizer/weight_delta_rel": 0.05789962783455849,
      "model/normalizer/weight_norm": 78.29312896728516,
      "pose_mae_dtheta": 0.07940938323736191,
      "pose_mae_dx": 0.03240127116441727,
      "pose_mae_dy": 0.0336819551885128,
      "pose_rmse_dtheta": 0.2088591754436493,
      "pose_rmse_dx": 0.0819401666522026,
      "pose_rmse_dy": 0.0893130674958229,
      "pose_rmse_mean": 0.126704141497612,
      "rmse_dtheta": 0.02562527172267437,
      "rmse_dx": 0.006040904670953751,
      "rmse_dy": 0.008330126293003559,
      "rmse_mean": 0.013332100585103035,
      "rotation_flip": 0.009009009227156639,
      "sparse_tokens": 32089.0,
      "step": 4250,
      "turn_loss": 0.10172149538993835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19750046459765844,
      "grad_norm": 0.5817524194717407,
      "learning_rate": 7.302876936276547e-06,
      "loss": 0.1581,
      "mae_dtheta": 0.013485630042850971,
      "mae_dx": 0.0027336785569787025,
      "mae_dy": 0.0044619981199502945,
      "pose_mae_dtheta": 0.09478839486837387,
      "pose_mae_dx": 0.03376005217432976,
      "pose_mae_dy": 0.040613628923892975,
      "pose_rmse_dtheta": 0.21602784097194672,
      "pose_rmse_dx": 0.08753883838653564,
      "pose_rmse_dy": 0.0972602590918541,
      "pose_rmse_mean": 0.13360899686813354,
      "rmse_dtheta": 0.028077613562345505,
      "rmse_dx": 0.007657188456505537,
      "rmse_dy": 0.009014955721795559,
      "rmse_mean": 0.014916586689651012,
      "rotation_flip": 0.004699927754700184,
      "sparse_tokens": 32105.0,
      "step": 4251,
      "turn_loss": 0.12067930400371552,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.19754692436350121,
      "grad_norm": 0.47915297746658325,
      "learning_rate": 7.301703226844328e-06,
      "loss": 0.1447,
      "mae_dtheta": 0.011952311731874943,
      "mae_dx": 0.001792878843843937,
      "mae_dy": 0.003057036781683564,
      "pose_mae_dtheta": 0.0825074091553688,
      "pose_mae_dx": 0.02326778881251812,
      "pose_mae_dy": 0.03411509469151497,
      "pose_rmse_dtheta": 0.1799393594264984,
      "pose_rmse_dx": 0.051966287195682526,
      "pose_rmse_dy": 0.07088931649923325,
      "pose_rmse_mean": 0.10093165934085846,
      "rmse_dtheta": 0.023933416232466698,
      "rmse_dx": 0.004776766523718834,
      "rmse_dy": 0.006222391966730356,
      "rmse_mean": 0.011644192039966583,
      "rotation_flip": 0.006050955504179001,
      "sparse_tokens": 32153.0,
      "step": 4252,
      "turn_loss": 0.10702293366193771,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.197593384129344,
      "grad_norm": 0.500104546546936,
      "learning_rate": 7.300529356452768e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.024377882480621338,
      "mae_dx": 0.0015882275765761733,
      "mae_dy": 0.0026606537867337465,
      "pose_mae_dtheta": 0.16491632163524628,
      "pose_mae_dx": 0.016563255339860916,
      "pose_mae_dy": 0.025115586817264557,
      "pose_rmse_dtheta": 0.31039658188819885,
      "pose_rmse_dx": 0.04084888845682144,
      "pose_rmse_dy": 0.05005677416920662,
      "pose_rmse_mean": 0.13376742601394653,
      "rmse_dtheta": 0.041436489671468735,
      "rmse_dx": 0.00461186608299613,
      "rmse_dy": 0.006313601043075323,
      "rmse_mean": 0.017453985288739204,
      "rotation_flip": 0.010152284055948257,
      "sparse_tokens": 3441.0,
      "step": 4253,
      "turn_loss": 0.20367105305194855,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.19763984389518677,
      "grad_norm": 0.5055246353149414,
      "learning_rate": 7.299355325183955e-06,
      "loss": 0.1325,
      "mae_dtheta": 0.045927222818136215,
      "mae_dx": 0.01665307767689228,
      "mae_dy": 0.010019952431321144,
      "pose_mae_dtheta": 0.3715101182460785,
      "pose_mae_dx": 0.1635284274816513,
      "pose_mae_dy": 0.09273258596658707,
      "pose_rmse_dtheta": 0.6080995798110962,
      "pose_rmse_dx": 0.33995237946510315,
      "pose_rmse_dy": 0.2080264836549759,
      "pose_rmse_mean": 0.3853594958782196,
      "rmse_dtheta": 0.06214499473571777,
      "rmse_dx": 0.029971392825245857,
      "rmse_dy": 0.02070571295917034,
      "rmse_mean": 0.03760736808180809,
      "rotation_flip": 0.016949152573943138,
      "sparse_tokens": 9518.0,
      "step": 4254,
      "turn_loss": 0.43421509861946106,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.19768630366102954,
      "grad_norm": 0.48205187916755676,
      "learning_rate": 7.298181133119987e-06,
      "loss": 0.1103,
      "mae_dtheta": 0.01528090052306652,
      "mae_dx": 0.0027570126112550497,
      "mae_dy": 0.004668385721743107,
      "pose_mae_dtheta": 0.10891401022672653,
      "pose_mae_dx": 0.038676243275403976,
      "pose_mae_dy": 0.0450725294649601,
      "pose_rmse_dtheta": 0.25679242610931396,
      "pose_rmse_dx": 0.09833826124668121,
      "pose_rmse_dy": 0.1013561338186264,
      "pose_rmse_mean": 0.15216228365898132,
      "rmse_dtheta": 0.029978249222040176,
      "rmse_dx": 0.007694725412875414,
      "rmse_dy": 0.010123138315975666,
      "rmse_mean": 0.01593203842639923,
      "rotation_flip": 0.007014028262346983,
      "sparse_tokens": 32073.0,
      "step": 4255,
      "turn_loss": 0.12867790460586548,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.19773276342687232,
      "grad_norm": 0.48504549264907837,
      "learning_rate": 7.297006780342981e-06,
      "loss": 0.1086,
      "mae_dtheta": 0.012558374553918839,
      "mae_dx": 0.0021385501604527235,
      "mae_dy": 0.003394313855096698,
      "pose_mae_dtheta": 0.07390916347503662,
      "pose_mae_dx": 0.028838954865932465,
      "pose_mae_dy": 0.04003950580954552,
      "pose_rmse_dtheta": 0.13822725415229797,
      "pose_rmse_dx": 0.07045046985149384,
      "pose_rmse_dy": 0.10688985884189606,
      "pose_rmse_mean": 0.10518919676542282,
      "rmse_dtheta": 0.022988229990005493,
      "rmse_dx": 0.005372033454477787,
      "rmse_dy": 0.007951180450618267,
      "rmse_mean": 0.012103814631700516,
      "rotation_flip": 0.013166144490242004,
      "sparse_tokens": 32121.0,
      "step": 4256,
      "turn_loss": 0.12870092689990997,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.1977792231927151,
      "grad_norm": 0.49777841567993164,
      "learning_rate": 7.295832266935059e-06,
      "loss": 0.133,
      "mae_dtheta": 0.0075492109172046185,
      "mae_dx": 0.0017669540829956532,
      "mae_dy": 0.0008467630250379443,
      "pose_mae_dtheta": 0.055524792522192,
      "pose_mae_dx": 0.01657092012465,
      "pose_mae_dy": 0.012615329585969448,
      "pose_rmse_dtheta": 0.18086457252502441,
      "pose_rmse_dx": 0.04211842268705368,
      "pose_rmse_dy": 0.03345751017332077,
      "pose_rmse_mean": 0.08548017591238022,
      "rmse_dtheta": 0.02114274725317955,
      "rmse_dx": 0.005632348358631134,
      "rmse_dy": 0.00179243681486696,
      "rmse_mean": 0.009522510692477226,
      "rotation_flip": 0.0013440860202535987,
      "sparse_tokens": 32185.0,
      "step": 4257,
      "turn_loss": 0.06528688967227936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.1978256829585579,
      "grad_norm": 0.6928602457046509,
      "learning_rate": 7.294657592978354e-06,
      "loss": 0.1647,
      "mae_dtheta": 0.03341665863990784,
      "mae_dx": 0.01241740770637989,
      "mae_dy": 0.005029451567679644,
      "pose_mae_dtheta": 0.2543655335903168,
      "pose_mae_dx": 0.08587194979190826,
      "pose_mae_dy": 0.07088007032871246,
      "pose_rmse_dtheta": 0.46338996291160583,
      "pose_rmse_dx": 0.19498129189014435,
      "pose_rmse_dy": 0.15257234871387482,
      "pose_rmse_mean": 0.2703145444393158,
      "rmse_dtheta": 0.04979173466563225,
      "rmse_dx": 0.025285473093390465,
      "rmse_dy": 0.008670618757605553,
      "rmse_mean": 0.027915943413972855,
      "rotation_flip": 0.012173913419246674,
      "sparse_tokens": 9964.0,
      "step": 4258,
      "turn_loss": 0.2862688899040222,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 33310.0,
      "epoch": 0.19787214272440068,
      "grad_norm": 0.5700986981391907,
      "learning_rate": 7.293482758555011e-06,
      "loss": 0.1845,
      "mae_dtheta": 0.037023529410362244,
      "mae_dx": 0.013493153266608715,
      "mae_dy": 0.005307408981025219,
      "pose_mae_dtheta": 0.2999825179576874,
      "pose_mae_dx": 0.1044032871723175,
      "pose_mae_dy": 0.07573438435792923,
      "pose_rmse_dtheta": 0.49886804819107056,
      "pose_rmse_dx": 0.22516272962093353,
      "pose_rmse_dy": 0.17760632932186127,
      "pose_rmse_mean": 0.30054572224617004,
      "rmse_dtheta": 0.05397336184978485,
      "rmse_dx": 0.02654002048075199,
      "rmse_dy": 0.010622142814099789,
      "rmse_mean": 0.03037850931286812,
      "rotation_flip": 0.015574302524328232,
      "sparse_tokens": 25878.0,
      "step": 4259,
      "turn_loss": 0.2755125164985657,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 11669.0,
      "epoch": 0.19791860249024346,
      "grad_norm": 0.5233641266822815,
      "learning_rate": 7.292307763747188e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.03262533247470856,
      "mae_dx": 0.016571033746004105,
      "mae_dy": 0.005906090606004,
      "pose_mae_dtheta": 0.2237759679555893,
      "pose_mae_dx": 0.12969888746738434,
      "pose_mae_dy": 0.07949168235063553,
      "pose_rmse_dtheta": 0.39550843834877014,
      "pose_rmse_dx": 0.29130926728248596,
      "pose_rmse_dy": 0.14779755473136902,
      "pose_rmse_mean": 0.27820509672164917,
      "rmse_dtheta": 0.04621192812919617,
      "rmse_dx": 0.031014766544103622,
      "rmse_dy": 0.010345392860472202,
      "rmse_mean": 0.02919069677591324,
      "rotation_flip": 0.01413427572697401,
      "sparse_tokens": 9306.0,
      "step": 4260,
      "turn_loss": 0.34574803709983826,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.19796506225608623,
      "grad_norm": 0.6208983659744263,
      "learning_rate": 7.291132608637053e-06,
      "loss": 0.1379,
      "mae_dtheta": 0.011751489713788033,
      "mae_dx": 0.0015968846855685115,
      "mae_dy": 0.0028666171710938215,
      "pose_mae_dtheta": 0.07942724227905273,
      "pose_mae_dx": 0.02412581443786621,
      "pose_mae_dy": 0.03512035310268402,
      "pose_rmse_dtheta": 0.19751502573490143,
      "pose_rmse_dx": 0.061184126883745193,
      "pose_rmse_dy": 0.09379324316978455,
      "pose_rmse_mean": 0.11749746650457382,
      "rmse_dtheta": 0.024560609832406044,
      "rmse_dx": 0.004661682061851025,
      "rmse_dy": 0.006167128682136536,
      "rmse_mean": 0.011796473525464535,
      "rotation_flip": 0.005050505045801401,
      "sparse_tokens": 32041.0,
      "step": 4261,
      "turn_loss": 0.09091515839099884,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.198011522021929,
      "grad_norm": 0.31772851943969727,
      "learning_rate": 7.289957293306784e-06,
      "loss": 0.0804,
      "mae_dtheta": 0.011704068630933762,
      "mae_dx": 0.0022159041836857796,
      "mae_dy": 0.0003781642881222069,
      "pose_mae_dtheta": 0.08082480728626251,
      "pose_mae_dx": 0.016733724623918533,
      "pose_mae_dy": 0.005073780193924904,
      "pose_rmse_dtheta": 0.2758414149284363,
      "pose_rmse_dx": 0.04421596601605415,
      "pose_rmse_dy": 0.013461990281939507,
      "pose_rmse_mean": 0.1111731231212616,
      "rmse_dtheta": 0.03391105309128761,
      "rmse_dx": 0.006313573103398085,
      "rmse_dy": 0.0010558281792327762,
      "rmse_mean": 0.013760152272880077,
      "rotation_flip": 0.004507042467594147,
      "sparse_tokens": 32217.0,
      "step": 4262,
      "turn_loss": 0.060936715453863144,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.1980579817877718,
      "grad_norm": 0.5016586184501648,
      "learning_rate": 7.288781817838574e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.007916933856904507,
      "mae_dx": 0.0015582540072500706,
      "mae_dy": 0.0012059911387041211,
      "pose_mae_dtheta": 0.05894264578819275,
      "pose_mae_dx": 0.01640292815864086,
      "pose_mae_dy": 0.015909936279058456,
      "pose_rmse_dtheta": 0.19379399716854095,
      "pose_rmse_dx": 0.0532681979238987,
      "pose_rmse_dy": 0.045158933848142624,
      "pose_rmse_mean": 0.09740704298019409,
      "rmse_dtheta": 0.023582546040415764,
      "rmse_dx": 0.005648019723594189,
      "rmse_dy": 0.003122099209576845,
      "rmse_mean": 0.010784221813082695,
      "rotation_flip": 0.0033538290299475193,
      "sparse_tokens": 32121.0,
      "step": 4263,
      "turn_loss": 0.058879490941762924,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.19810444155361456,
      "grad_norm": 0.5686848759651184,
      "learning_rate": 7.287606182314621e-06,
      "loss": 0.0969,
      "mae_dtheta": 0.010405067354440689,
      "mae_dx": 0.0022432291880249977,
      "mae_dy": 0.0031098006293177605,
      "pose_mae_dtheta": 0.07791762799024582,
      "pose_mae_dx": 0.031196150928735733,
      "pose_mae_dy": 0.03654205799102783,
      "pose_rmse_dtheta": 0.1930883675813675,
      "pose_rmse_dx": 0.08748174458742142,
      "pose_rmse_dy": 0.09272697567939758,
      "pose_rmse_mean": 0.12443237006664276,
      "rmse_dtheta": 0.022491784766316414,
      "rmse_dx": 0.006854839622974396,
      "rmse_dy": 0.007020965684205294,
      "rmse_mean": 0.012122530490159988,
      "rotation_flip": 0.00741608114913106,
      "sparse_tokens": 32121.0,
      "step": 4264,
      "turn_loss": 0.09878705441951752,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.19815090131945734,
      "grad_norm": 0.9836292862892151,
      "learning_rate": 7.286430386817143e-06,
      "loss": 0.324,
      "mae_dtheta": 0.03922446444630623,
      "mae_dx": 0.013190476223826408,
      "mae_dy": 0.007514068391174078,
      "pose_mae_dtheta": 0.37801751494407654,
      "pose_mae_dx": 0.08077123016119003,
      "pose_mae_dy": 0.08658267557621002,
      "pose_rmse_dtheta": 0.6408752799034119,
      "pose_rmse_dx": 0.1955854892730713,
      "pose_rmse_dy": 0.17889243364334106,
      "pose_rmse_mean": 0.338451087474823,
      "rmse_dtheta": 0.058477047830820084,
      "rmse_dx": 0.024647260084748268,
      "rmse_dy": 0.013942345976829529,
      "rmse_mean": 0.03235555440187454,
      "rotation_flip": 0.006493506487458944,
      "sparse_tokens": 7417.0,
      "step": 4265,
      "turn_loss": 0.4431785047054291,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.19819736108530012,
      "grad_norm": 0.5360729098320007,
      "learning_rate": 7.285254431428358e-06,
      "loss": 0.1963,
      "mae_dtheta": 0.03943618759512901,
      "mae_dx": 0.010766187682747841,
      "mae_dy": 0.005863193888217211,
      "pose_mae_dtheta": 0.31621187925338745,
      "pose_mae_dx": 0.08542796969413757,
      "pose_mae_dy": 0.06079478934407234,
      "pose_rmse_dtheta": 0.5233304500579834,
      "pose_rmse_dx": 0.1926891803741455,
      "pose_rmse_dy": 0.14983607828617096,
      "pose_rmse_mean": 0.2886185646057129,
      "rmse_dtheta": 0.056512411683797836,
      "rmse_dx": 0.023065926507115364,
      "rmse_dy": 0.012002622708678246,
      "rmse_mean": 0.030526988208293915,
      "rotation_flip": 0.010427528992295265,
      "sparse_tokens": 15164.0,
      "step": 4266,
      "turn_loss": 0.3181741535663605,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 31790.0,
      "epoch": 0.19824382085114292,
      "grad_norm": 0.6395080089569092,
      "learning_rate": 7.284078316230504e-06,
      "loss": 0.1816,
      "mae_dtheta": 0.042352329939603806,
      "mae_dx": 0.011392878368496895,
      "mae_dy": 0.007968357764184475,
      "pose_mae_dtheta": 0.3207207918167114,
      "pose_mae_dx": 0.08119169622659683,
      "pose_mae_dy": 0.08338560909032822,
      "pose_rmse_dtheta": 0.5458338856697083,
      "pose_rmse_dx": 0.1876785308122635,
      "pose_rmse_dy": 0.22548618912696838,
      "pose_rmse_mean": 0.31966620683670044,
      "rmse_dtheta": 0.06189800426363945,
      "rmse_dx": 0.023473216220736504,
      "rmse_dy": 0.018501361832022667,
      "rmse_mean": 0.03462419658899307,
      "rotation_flip": 0.01654996909201145,
      "sparse_tokens": 24249.0,
      "step": 4267,
      "turn_loss": 0.33514121174812317,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.1982902806169857,
      "grad_norm": 0.6617230176925659,
      "learning_rate": 7.282902041305828e-06,
      "loss": 0.1293,
      "mae_dtheta": 0.008887547068297863,
      "mae_dx": 0.0013836785219609737,
      "mae_dy": 0.0015719746006652713,
      "pose_mae_dtheta": 0.06157827377319336,
      "pose_mae_dx": 0.016587305814027786,
      "pose_mae_dy": 0.02011309564113617,
      "pose_rmse_dtheta": 0.1911717802286148,
      "pose_rmse_dx": 0.05102302506566048,
      "pose_rmse_dy": 0.055918216705322266,
      "pose_rmse_mean": 0.09937100857496262,
      "rmse_dtheta": 0.022292137145996094,
      "rmse_dx": 0.005030013620853424,
      "rmse_dy": 0.003930542152374983,
      "rmse_mean": 0.010417564772069454,
      "rotation_flip": 0.00186741363722831,
      "sparse_tokens": 32073.0,
      "step": 4268,
      "turn_loss": 0.05647444352507591,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19833674038282847,
      "grad_norm": 0.5294661521911621,
      "learning_rate": 7.281725606736588e-06,
      "loss": 0.0813,
      "mae_dtheta": 0.008912933059036732,
      "mae_dx": 0.003762031439691782,
      "mae_dy": 0.0019480484770610929,
      "pose_mae_dtheta": 0.06480884552001953,
      "pose_mae_dx": 0.03622846677899361,
      "pose_mae_dy": 0.025686588138341904,
      "pose_rmse_dtheta": 0.1461925208568573,
      "pose_rmse_dx": 0.10774822533130646,
      "pose_rmse_dy": 0.06786447018384933,
      "pose_rmse_mean": 0.10726841539144516,
      "rmse_dtheta": 0.019777772948145866,
      "rmse_dx": 0.011750434525310993,
      "rmse_dy": 0.005075672175735235,
      "rmse_mean": 0.012201293371617794,
      "rotation_flip": 0.00561797758564353,
      "sparse_tokens": 32105.0,
      "step": 4269,
      "turn_loss": 0.07858169078826904,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.19838320014867125,
      "grad_norm": 0.5114362835884094,
      "learning_rate": 7.28054901260505e-06,
      "loss": 0.134,
      "mae_dtheta": 0.01106695830821991,
      "mae_dx": 0.0020420679356902838,
      "mae_dy": 0.0013988580321893096,
      "pose_mae_dtheta": 0.08542975038290024,
      "pose_mae_dx": 0.022815411910414696,
      "pose_mae_dy": 0.025015948340296745,
      "pose_rmse_dtheta": 0.22565245628356934,
      "pose_rmse_dx": 0.05809083953499794,
      "pose_rmse_dy": 0.06210373342037201,
      "pose_rmse_mean": 0.115282341837883,
      "rmse_dtheta": 0.026836270466446877,
      "rmse_dx": 0.0062899524345994,
      "rmse_dy": 0.0027386408764868975,
      "rmse_mean": 0.011954954825341702,
      "rotation_flip": 0.0049393801018595695,
      "sparse_tokens": 32137.0,
      "step": 4270,
      "turn_loss": 0.07647471129894257,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19842965991451403,
      "grad_norm": 0.7734158635139465,
      "learning_rate": 7.279372258993498e-06,
      "loss": 0.1527,
      "mae_dtheta": 0.010635116137564182,
      "mae_dx": 0.0017418924253433943,
      "mae_dy": 0.0025345233734697104,
      "pose_mae_dtheta": 0.07254409790039062,
      "pose_mae_dx": 0.02452196180820465,
      "pose_mae_dy": 0.027898605912923813,
      "pose_rmse_dtheta": 0.18879930675029755,
      "pose_rmse_dx": 0.07138819247484207,
      "pose_rmse_dy": 0.06484222412109375,
      "pose_rmse_mean": 0.10834324359893799,
      "rmse_dtheta": 0.023625748232007027,
      "rmse_dx": 0.005097278859466314,
      "rmse_dy": 0.005938268732279539,
      "rmse_mean": 0.011553766205906868,
      "rotation_flip": 0.0019409938249737024,
      "sparse_tokens": 32105.0,
      "step": 4271,
      "turn_loss": 0.08386197686195374,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.1984761196803568,
      "grad_norm": 0.5466897487640381,
      "learning_rate": 7.278195345984218e-06,
      "loss": 0.1618,
      "mae_dtheta": 0.011505414731800556,
      "mae_dx": 0.0024068187922239304,
      "mae_dy": 0.002373332856222987,
      "pose_mae_dtheta": 0.07933904230594635,
      "pose_mae_dx": 0.02544889785349369,
      "pose_mae_dy": 0.02423478290438652,
      "pose_rmse_dtheta": 0.21535645425319672,
      "pose_rmse_dx": 0.0942106693983078,
      "pose_rmse_dy": 0.05613163858652115,
      "pose_rmse_mean": 0.12189958989620209,
      "rmse_dtheta": 0.027331536635756493,
      "rmse_dx": 0.008242698386311531,
      "rmse_dy": 0.006818564608693123,
      "rmse_mean": 0.014130933210253716,
      "rotation_flip": 0.00838112086057663,
      "sparse_tokens": 32089.0,
      "step": 4272,
      "turn_loss": 0.09973286092281342,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19852257944619958,
      "grad_norm": 0.5805445313453674,
      "learning_rate": 7.2770182736595164e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.008223327808082104,
      "mae_dx": 0.001534473616629839,
      "mae_dy": 0.001920030452311039,
      "pose_mae_dtheta": 0.05965059995651245,
      "pose_mae_dx": 0.023011336103081703,
      "pose_mae_dy": 0.027487745508551598,
      "pose_rmse_dtheta": 0.1436827927827835,
      "pose_rmse_dx": 0.058714885264635086,
      "pose_rmse_dy": 0.06602444499731064,
      "pose_rmse_mean": 0.08947404474020004,
      "rmse_dtheta": 0.01904905214905739,
      "rmse_dx": 0.004372067749500275,
      "rmse_dy": 0.004321183077991009,
      "rmse_mean": 0.009247435256838799,
      "rotation_flip": 0.003507233690470457,
      "sparse_tokens": 32105.0,
      "step": 4273,
      "turn_loss": 0.06795945018529892,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.19856903921204236,
      "grad_norm": 0.7288495898246765,
      "learning_rate": 7.275841042101703e-06,
      "loss": 0.1433,
      "mae_dtheta": 0.02856818586587906,
      "mae_dx": 0.007328507024794817,
      "mae_dy": 0.0032035501208156347,
      "pose_mae_dtheta": 0.20540176331996918,
      "pose_mae_dx": 0.05173216015100479,
      "pose_mae_dy": 0.04704180359840393,
      "pose_rmse_dtheta": 0.4172155559062958,
      "pose_rmse_dx": 0.12724393606185913,
      "pose_rmse_dy": 0.1366199553012848,
      "pose_rmse_mean": 0.22702646255493164,
      "rmse_dtheta": 0.048547178506851196,
      "rmse_dx": 0.018374763429164886,
      "rmse_dy": 0.006749395281076431,
      "rmse_mean": 0.024557113647460938,
      "rotation_flip": 0.006839945446699858,
      "sparse_tokens": 12585.0,
      "step": 4274,
      "turn_loss": 0.18787439167499542,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19861549897788516,
      "grad_norm": 0.44838425517082214,
      "learning_rate": 7.274663651393105e-06,
      "loss": 0.1137,
      "mae_dtheta": 0.009692603722214699,
      "mae_dx": 0.0023417919874191284,
      "mae_dy": 0.002596244215965271,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4483844041824341,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.37684631347656,
      "model/head/act_norm_mean": 118.04031526199495,
      "model/head/act_norm_min": 58.554779052734375,
      "model/head/act_over_embed": 81.11840975888572,
      "model/head/grad_frac": 0.11059711128473282,
      "model/head/grad_norm": 0.04959002137184143,
      "model/head/grad_zero_frac": 0.000150704086991027,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6988685684974747,
      "model/head/update_ratio": 0.0008513596840202808,
      "model/head/weight_delta": 7.709683895111084,
      "model/head/weight_delta_rel": 0.13525068759918213,
      "model/head/weight_norm": 58.24802780151367,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4181680977344513,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41810187096018425,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41802966594696045,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2873235200552258,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06768970936536789,
      "model/modality_embedder.encoders.pose/grad_norm": 0.030351009219884872,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5203895739910314,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009827201720327139,
      "model/modality_embedder.encoders.pose/weight_delta": 2.534320592880249,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08280415087938309,
      "model/modality_embedder.encoders.pose/weight_norm": 30.88469123840332,
      "model/modality_embedder/grad_frac": 0.06768970936536789,
      "model/modality_embedder/grad_norm": 0.030351009219884872,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5203895739910314,
      "model/modality_embedder/update_ratio": 0.0009827201720327139,
      "model/modality_embedder/weight_delta": 2.534320592880249,
      "model/modality_embedder/weight_delta_rel": 0.08280415087938309,
      "model/modality_embedder/weight_norm": 30.88469123840332,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.8218994140625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.321508738175403,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.13879108428955,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.71396850642644,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09779705107212067,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.043850671499967575,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001579275238327682,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.833638072013855,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06681887805461884,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.766326904296875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.02940368652344,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.326844837261504,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.044061660766602,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.40484488582326,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09527003020048141,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.042717594653367996,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014505935832858086,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.3192861080169678,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0803418830037117,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.448354721069336,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.6676025390625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.18135471781305,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 11.808733940124512,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.67928143793333,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10021841526031494,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.044936373829841614,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014781535137444735,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.4901185035705566,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08361351490020752,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.40034294128418,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.32621002197266,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.00080918310085,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.028044700622559,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.929627580480183,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11774749308824539,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0527961403131485,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017774408916011453,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.1259191036224365,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07265382260084152,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.70345687866211,
      "model/normalizer/grad_frac": 0.4536527395248413,
      "model/normalizer/grad_norm": 0.2034108191728592,
      "model/normalizer/grad_zero_frac": 0.00018198772158939391,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0025979706551879644,
      "model/normalizer/weight_delta": 4.514763832092285,
      "model/normalizer/weight_delta_rel": 0.05814754590392113,
      "model/normalizer/weight_norm": 78.2960433959961,
      "pose_mae_dtheta": 0.060286231338977814,
      "pose_mae_dx": 0.024925103411078453,
      "pose_mae_dy": 0.024634292349219322,
      "pose_rmse_dtheta": 0.13883647322654724,
      "pose_rmse_dx": 0.06490657478570938,
      "pose_rmse_dy": 0.06374592334032059,
      "pose_rmse_mean": 0.08916299045085907,
      "rmse_dtheta": 0.021912511438131332,
      "rmse_dx": 0.006928436923772097,
      "rmse_dy": 0.006840952672064304,
      "rmse_mean": 0.011893967166543007,
      "rotation_flip": 0.005770084448158741,
      "sparse_tokens": 32105.0,
      "step": 4275,
      "turn_loss": 0.10212630778551102,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.19866195874372794,
      "grad_norm": 0.5267191529273987,
      "learning_rate": 7.273486101616057e-06,
      "loss": 0.0915,
      "mae_dtheta": 0.012963326647877693,
      "mae_dx": 0.0028555511962622404,
      "mae_dy": 0.003160575171932578,
      "pose_mae_dtheta": 0.08784688264131546,
      "pose_mae_dx": 0.029739633202552795,
      "pose_mae_dy": 0.03418705612421036,
      "pose_rmse_dtheta": 0.19552500545978546,
      "pose_rmse_dx": 0.08356556296348572,
      "pose_rmse_dy": 0.07911928743124008,
      "pose_rmse_mean": 0.11940329521894455,
      "rmse_dtheta": 0.0279504656791687,
      "rmse_dx": 0.007900578901171684,
      "rmse_dy": 0.007912213914096355,
      "rmse_mean": 0.014587754383683205,
      "rotation_flip": 0.00785046722739935,
      "sparse_tokens": 32137.0,
      "step": 4276,
      "turn_loss": 0.12152840197086334,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.19870841850957072,
      "grad_norm": 0.4732164442539215,
      "learning_rate": 7.272308392852905e-06,
      "loss": 0.0801,
      "mae_dtheta": 0.005426900461316109,
      "mae_dx": 0.0017300854669883847,
      "mae_dy": 0.0004419680335558951,
      "pose_mae_dtheta": 0.0377914234995842,
      "pose_mae_dx": 0.014469930902123451,
      "pose_mae_dy": 0.004799890797585249,
      "pose_rmse_dtheta": 0.13351109623908997,
      "pose_rmse_dx": 0.039974890649318695,
      "pose_rmse_dy": 0.011849907226860523,
      "pose_rmse_mean": 0.061778634786605835,
      "rmse_dtheta": 0.019049782305955887,
      "rmse_dx": 0.0048544518649578094,
      "rmse_dy": 0.0011156193213537335,
      "rmse_mean": 0.008339951746165752,
      "rotation_flip": 0.0022753127850592136,
      "sparse_tokens": 32201.0,
      "step": 4277,
      "turn_loss": 0.045725610107183456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.1987548782754135,
      "grad_norm": 0.6001630425453186,
      "learning_rate": 7.271130525186008e-06,
      "loss": 0.2152,
      "mae_dtheta": 0.030141431838274002,
      "mae_dx": 0.00927366130053997,
      "mae_dy": 0.006484807934612036,
      "pose_mae_dtheta": 0.24909935891628265,
      "pose_mae_dx": 0.06410908699035645,
      "pose_mae_dy": 0.06883791834115982,
      "pose_rmse_dtheta": 0.4024181365966797,
      "pose_rmse_dx": 0.13631203770637512,
      "pose_rmse_dy": 0.1489599347114563,
      "pose_rmse_mean": 0.22923003137111664,
      "rmse_dtheta": 0.04579993709921837,
      "rmse_dx": 0.019539719447493553,
      "rmse_dy": 0.01131642796099186,
      "rmse_mean": 0.02555202692747116,
      "rotation_flip": 0.024169184267520905,
      "sparse_tokens": 6408.0,
      "step": 4278,
      "turn_loss": 0.23640909790992737,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.19880133804125627,
      "grad_norm": 0.45595237612724304,
      "learning_rate": 7.269952498697734e-06,
      "loss": 0.1162,
      "mae_dtheta": 0.007976168766617775,
      "mae_dx": 0.001374419778585434,
      "mae_dy": 0.0003657697234302759,
      "pose_mae_dtheta": 0.06256163120269775,
      "pose_mae_dx": 0.010778957977890968,
      "pose_mae_dy": 0.006467086263000965,
      "pose_rmse_dtheta": 0.2637145519256592,
      "pose_rmse_dx": 0.02775712125003338,
      "pose_rmse_dy": 0.018226681277155876,
      "pose_rmse_mean": 0.10323278605937958,
      "rmse_dtheta": 0.028993826359510422,
      "rmse_dx": 0.0040296148508787155,
      "rmse_dy": 0.0007555885822512209,
      "rmse_mean": 0.01125967688858509,
      "rotation_flip": 0.002033898374065757,
      "sparse_tokens": 32201.0,
      "step": 4279,
      "turn_loss": 0.04485069587826729,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.19884779780709905,
      "grad_norm": 0.5933937430381775,
      "learning_rate": 7.268774313470465e-06,
      "loss": 0.1865,
      "mae_dtheta": 0.012738835997879505,
      "mae_dx": 0.0018668007105588913,
      "mae_dy": 0.002324467757716775,
      "pose_mae_dtheta": 0.0921734943985939,
      "pose_mae_dx": 0.022720905020833015,
      "pose_mae_dy": 0.030477453023195267,
      "pose_rmse_dtheta": 0.244463250041008,
      "pose_rmse_dx": 0.06455200910568237,
      "pose_rmse_dy": 0.08276192843914032,
      "pose_rmse_mean": 0.13059240579605103,
      "rmse_dtheta": 0.029740365222096443,
      "rmse_dx": 0.0054067992605268955,
      "rmse_dy": 0.006537600886076689,
      "rmse_mean": 0.013894922100007534,
      "rotation_flip": 0.004920049104839563,
      "sparse_tokens": 32137.0,
      "step": 4280,
      "turn_loss": 0.09351138025522232,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.19889425757294182,
      "grad_norm": 0.727514922618866,
      "learning_rate": 7.2675959695865896e-06,
      "loss": 0.1492,
      "mae_dtheta": 0.03898363932967186,
      "mae_dx": 0.007246853783726692,
      "mae_dy": 0.005600829608738422,
      "pose_mae_dtheta": 0.2960996627807617,
      "pose_mae_dx": 0.06674455851316452,
      "pose_mae_dy": 0.07966112345457077,
      "pose_rmse_dtheta": 0.5327897667884827,
      "pose_rmse_dx": 0.13427263498306274,
      "pose_rmse_dy": 0.17798331379890442,
      "pose_rmse_mean": 0.2816818952560425,
      "rmse_dtheta": 0.05693012848496437,
      "rmse_dx": 0.015909472480416298,
      "rmse_dy": 0.011035111732780933,
      "rmse_mean": 0.02795824036002159,
      "rotation_flip": 0.018372703343629837,
      "sparse_tokens": 5967.0,
      "step": 4281,
      "turn_loss": 0.26294708251953125,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.1989407173387846,
      "grad_norm": 0.47815027832984924,
      "learning_rate": 7.2664174671285105e-06,
      "loss": 0.1257,
      "mae_dtheta": 0.012922880239784718,
      "mae_dx": 0.0019671109039336443,
      "mae_dy": 0.002536904066801071,
      "pose_mae_dtheta": 0.08973280340433121,
      "pose_mae_dx": 0.02634192258119583,
      "pose_mae_dy": 0.031182382255792618,
      "pose_rmse_dtheta": 0.2237047255039215,
      "pose_rmse_dx": 0.06484486907720566,
      "pose_rmse_dy": 0.06941767781972885,
      "pose_rmse_mean": 0.11932243406772614,
      "rmse_dtheta": 0.02636753022670746,
      "rmse_dx": 0.0054336972534656525,
      "rmse_dy": 0.0052128019742667675,
      "rmse_mean": 0.012338010594248772,
      "rotation_flip": 0.004922644235193729,
      "sparse_tokens": 32105.0,
      "step": 4282,
      "turn_loss": 0.0864916741847992,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1989871771046274,
      "grad_norm": 0.5404922962188721,
      "learning_rate": 7.265238806178642e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.008281334303319454,
      "mae_dx": 0.0015733836917206645,
      "mae_dy": 0.0019511719001457095,
      "pose_mae_dtheta": 0.06172499805688858,
      "pose_mae_dx": 0.01931953988969326,
      "pose_mae_dy": 0.020838215947151184,
      "pose_rmse_dtheta": 0.15786069631576538,
      "pose_rmse_dx": 0.0641857236623764,
      "pose_rmse_dy": 0.04950182884931564,
      "pose_rmse_mean": 0.09051608294248581,
      "rmse_dtheta": 0.019941845908761024,
      "rmse_dx": 0.004813872277736664,
      "rmse_dy": 0.0049184514209628105,
      "rmse_mean": 0.0098913898691535,
      "rotation_flip": 0.010616784915328026,
      "sparse_tokens": 32057.0,
      "step": 4283,
      "turn_loss": 0.07383807748556137,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.19903363687047018,
      "grad_norm": 0.5720598697662354,
      "learning_rate": 7.264059986819407e-06,
      "loss": 0.1732,
      "mae_dtheta": 0.026340777054429054,
      "mae_dx": 0.00926279928535223,
      "mae_dy": 0.004763754550367594,
      "pose_mae_dtheta": 0.2332536280155182,
      "pose_mae_dx": 0.08447564393281937,
      "pose_mae_dy": 0.05894455313682556,
      "pose_rmse_dtheta": 0.42112088203430176,
      "pose_rmse_dx": 0.184867262840271,
      "pose_rmse_dy": 0.14495356380939484,
      "pose_rmse_mean": 0.2503139078617096,
      "rmse_dtheta": 0.044200554490089417,
      "rmse_dx": 0.02192734181880951,
      "rmse_dy": 0.008228025399148464,
      "rmse_mean": 0.02478530816733837,
      "rotation_flip": 0.00804289523512125,
      "sparse_tokens": 6336.0,
      "step": 4284,
      "turn_loss": 0.19631026685237885,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19908009663631296,
      "grad_norm": 0.5376706719398499,
      "learning_rate": 7.262881009133242e-06,
      "loss": 0.1353,
      "mae_dtheta": 0.009846234694123268,
      "mae_dx": 0.0019071010174229741,
      "mae_dy": 0.00243328046053648,
      "pose_mae_dtheta": 0.06743597984313965,
      "pose_mae_dx": 0.02524416334927082,
      "pose_mae_dy": 0.031912971287965775,
      "pose_rmse_dtheta": 0.13734035193920135,
      "pose_rmse_dx": 0.0616365484893322,
      "pose_rmse_dy": 0.07043442130088806,
      "pose_rmse_mean": 0.0898037776350975,
      "rmse_dtheta": 0.01953231915831566,
      "rmse_dx": 0.0053201294504106045,
      "rmse_dy": 0.005235400516539812,
      "rmse_mean": 0.010029283352196217,
      "rotation_flip": 0.0046260603703558445,
      "sparse_tokens": 32105.0,
      "step": 4285,
      "turn_loss": 0.09014908224344254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.19912655640215574,
      "grad_norm": 0.4668406844139099,
      "learning_rate": 7.261701873202595e-06,
      "loss": 0.0718,
      "mae_dtheta": 0.006648963317275047,
      "mae_dx": 0.0024386451113969088,
      "mae_dy": 0.0012994337594136596,
      "pose_mae_dtheta": 0.0553324893116951,
      "pose_mae_dx": 0.018171079456806183,
      "pose_mae_dy": 0.011958090588450432,
      "pose_rmse_dtheta": 0.18913458287715912,
      "pose_rmse_dx": 0.07999184727668762,
      "pose_rmse_dy": 0.03648025542497635,
      "pose_rmse_mean": 0.1018688902258873,
      "rmse_dtheta": 0.02127516269683838,
      "rmse_dx": 0.008935908786952496,
      "rmse_dy": 0.006464943289756775,
      "rmse_mean": 0.012225339189171791,
      "rotation_flip": 0.003318584058433771,
      "sparse_tokens": 32041.0,
      "step": 4286,
      "turn_loss": 0.056463927030563354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.1991730161679985,
      "grad_norm": 0.6370904445648193,
      "learning_rate": 7.2605225791099195e-06,
      "loss": 0.1372,
      "mae_dtheta": 0.012403405271470547,
      "mae_dx": 0.002170001855120063,
      "mae_dy": 0.0022151675075292587,
      "pose_mae_dtheta": 0.08195306360721588,
      "pose_mae_dx": 0.02813178487122059,
      "pose_mae_dy": 0.029910070821642876,
      "pose_rmse_dtheta": 0.19890445470809937,
      "pose_rmse_dx": 0.05724671855568886,
      "pose_rmse_dy": 0.06737491488456726,
      "pose_rmse_mean": 0.10784202814102173,
      "rmse_dtheta": 0.02639969438314438,
      "rmse_dx": 0.005863898899406195,
      "rmse_dy": 0.005013715475797653,
      "rmse_mean": 0.012425769120454788,
      "rotation_flip": 0.002600297098979354,
      "sparse_tokens": 32153.0,
      "step": 4287,
      "turn_loss": 0.11764980852603912,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.1992194759338413,
      "grad_norm": 0.6711470484733582,
      "learning_rate": 7.259343126937689e-06,
      "loss": 0.0881,
      "mae_dtheta": 0.011566033586859703,
      "mae_dx": 0.0019173697801306844,
      "mae_dy": 0.002738291397690773,
      "pose_mae_dtheta": 0.0756726786494255,
      "pose_mae_dx": 0.027813801541924477,
      "pose_mae_dy": 0.03091925010085106,
      "pose_rmse_dtheta": 0.17863015830516815,
      "pose_rmse_dx": 0.06474760174751282,
      "pose_rmse_dy": 0.07188159972429276,
      "pose_rmse_mean": 0.10508646070957184,
      "rmse_dtheta": 0.02450081892311573,
      "rmse_dx": 0.005248147528618574,
      "rmse_dy": 0.005972275510430336,
      "rmse_mean": 0.011907081119716167,
      "rotation_flip": 0.00469667324796319,
      "sparse_tokens": 32057.0,
      "step": 4288,
      "turn_loss": 0.10740368813276291,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19926593569968407,
      "grad_norm": 0.5259396433830261,
      "learning_rate": 7.2581635167683805e-06,
      "loss": 0.1083,
      "mae_dtheta": 0.014757449738681316,
      "mae_dx": 0.0023040412925183773,
      "mae_dy": 0.0031469305977225304,
      "pose_mae_dtheta": 0.11159609258174896,
      "pose_mae_dx": 0.03493737429380417,
      "pose_mae_dy": 0.06073693931102753,
      "pose_rmse_dtheta": 0.22156906127929688,
      "pose_rmse_dx": 0.0824722871184349,
      "pose_rmse_dy": 0.13219016790390015,
      "pose_rmse_mean": 0.14541050791740417,
      "rmse_dtheta": 0.027643566951155663,
      "rmse_dx": 0.0077725728042423725,
      "rmse_dy": 0.006054623983800411,
      "rmse_mean": 0.01382358931005001,
      "rotation_flip": 0.0019755037501454353,
      "sparse_tokens": 32089.0,
      "step": 4289,
      "turn_loss": 0.1344142109155655,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.19931239546552684,
      "grad_norm": 0.44352859258651733,
      "learning_rate": 7.256983748684485e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.010365411639213562,
      "mae_dx": 0.00264834426343441,
      "mae_dy": 0.00200690352357924,
      "pose_mae_dtheta": 0.06709400564432144,
      "pose_mae_dx": 0.027976790443062782,
      "pose_mae_dy": 0.025741374120116234,
      "pose_rmse_dtheta": 0.1497308760881424,
      "pose_rmse_dx": 0.08306697756052017,
      "pose_rmse_dy": 0.07055866718292236,
      "pose_rmse_mean": 0.10111884772777557,
      "rmse_dtheta": 0.020383095368742943,
      "rmse_dx": 0.00875924527645111,
      "rmse_dy": 0.004449189640581608,
      "rmse_mean": 0.011197177693247795,
      "rotation_flip": 0.004365079570561647,
      "sparse_tokens": 32105.0,
      "step": 4290,
      "turn_loss": 0.0751793310046196,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19935885523136965,
      "grad_norm": 0.5676368474960327,
      "learning_rate": 7.255803822768504e-06,
      "loss": 0.0923,
      "mae_dtheta": 0.0165041983127594,
      "mae_dx": 0.0023465664125978947,
      "mae_dy": 0.00426713190972805,
      "pose_mae_dtheta": 0.11296409368515015,
      "pose_mae_dx": 0.0358787477016449,
      "pose_mae_dy": 0.04695830121636391,
      "pose_rmse_dtheta": 0.25750377774238586,
      "pose_rmse_dx": 0.09707766771316528,
      "pose_rmse_dy": 0.11743441969156265,
      "pose_rmse_mean": 0.15733861923217773,
      "rmse_dtheta": 0.031017152592539787,
      "rmse_dx": 0.006074950564652681,
      "rmse_dy": 0.009386450052261353,
      "rmse_mean": 0.015492851845920086,
      "rotation_flip": 0.01079387217760086,
      "sparse_tokens": 32089.0,
      "step": 4291,
      "turn_loss": 0.1446501463651657,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.19940531499721242,
      "grad_norm": 0.5454285144805908,
      "learning_rate": 7.254623739102952e-06,
      "loss": 0.1084,
      "mae_dtheta": 0.03542682155966759,
      "mae_dx": 0.008540593087673187,
      "mae_dy": 0.004759753588587046,
      "pose_mae_dtheta": 0.26436561346054077,
      "pose_mae_dx": 0.05953177064657211,
      "pose_mae_dy": 0.04603208601474762,
      "pose_rmse_dtheta": 0.46284469962120056,
      "pose_rmse_dx": 0.1306820809841156,
      "pose_rmse_dy": 0.1184300109744072,
      "pose_rmse_mean": 0.23731893301010132,
      "rmse_dtheta": 0.053678642958402634,
      "rmse_dx": 0.019474077969789505,
      "rmse_dy": 0.009926164522767067,
      "rmse_mean": 0.02769296243786812,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 14935.0,
      "step": 4292,
      "turn_loss": 0.26444995403289795,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.1994517747630552,
      "grad_norm": 0.510206401348114,
      "learning_rate": 7.253443497770351e-06,
      "loss": 0.1023,
      "mae_dtheta": 0.04578334093093872,
      "mae_dx": 0.023606104776263237,
      "mae_dy": 0.0065400502644479275,
      "pose_mae_dtheta": 0.382670521736145,
      "pose_mae_dx": 0.19944685697555542,
      "pose_mae_dy": 0.07525122910737991,
      "pose_rmse_dtheta": 0.5923520922660828,
      "pose_rmse_dx": 0.34935158491134644,
      "pose_rmse_dy": 0.19111472368240356,
      "pose_rmse_mean": 0.3776061534881592,
      "rmse_dtheta": 0.061987318098545074,
      "rmse_dx": 0.03654709830880165,
      "rmse_dy": 0.014024647884070873,
      "rmse_mean": 0.03751968964934349,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 5925.0,
      "step": 4293,
      "turn_loss": 0.3551103472709656,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.19949823452889798,
      "grad_norm": 0.5244487524032593,
      "learning_rate": 7.252263098853236e-06,
      "loss": 0.105,
      "mae_dtheta": 0.00817662663757801,
      "mae_dx": 0.001051064464263618,
      "mae_dy": 0.0017962316051125526,
      "pose_mae_dtheta": 0.05774125084280968,
      "pose_mae_dx": 0.01741551235318184,
      "pose_mae_dy": 0.03225056082010269,
      "pose_rmse_dtheta": 0.11353173106908798,
      "pose_rmse_dx": 0.04380359128117561,
      "pose_rmse_dy": 0.07119759172201157,
      "pose_rmse_mean": 0.07617764174938202,
      "rmse_dtheta": 0.015538472682237625,
      "rmse_dx": 0.003352701896801591,
      "rmse_dy": 0.0036904660519212484,
      "rmse_mean": 0.007527213543653488,
      "rotation_flip": 0.0008699434692971408,
      "sparse_tokens": 32041.0,
      "step": 4294,
      "turn_loss": 0.05929207056760788,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.19954469429474075,
      "grad_norm": 0.5221118330955505,
      "learning_rate": 7.2510825424341555e-06,
      "loss": 0.1605,
      "mae_dtheta": 0.010544313117861748,
      "mae_dx": 0.002022377448156476,
      "mae_dy": 0.002456022659316659,
      "pose_mae_dtheta": 0.06986579298973083,
      "pose_mae_dx": 0.02668491192162037,
      "pose_mae_dy": 0.031745895743370056,
      "pose_rmse_dtheta": 0.16416983306407928,
      "pose_rmse_dx": 0.06503952294588089,
      "pose_rmse_dy": 0.07182193547487259,
      "pose_rmse_mean": 0.10034376382827759,
      "rmse_dtheta": 0.021824566647410393,
      "rmse_dx": 0.0056897494941949844,
      "rmse_dy": 0.0052996124140918255,
      "rmse_mean": 0.010937976650893688,
      "rotation_flip": 0.004698512144386768,
      "sparse_tokens": 32121.0,
      "step": 4295,
      "turn_loss": 0.10475210100412369,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19803.0,
      "epoch": 0.19959115406058353,
      "grad_norm": 0.4422000050544739,
      "learning_rate": 7.249901828595663e-06,
      "loss": 0.0952,
      "mae_dtheta": 0.02684844844043255,
      "mae_dx": 0.00893842987716198,
      "mae_dy": 0.0042613111436367035,
      "pose_mae_dtheta": 0.20814375579357147,
      "pose_mae_dx": 0.07185058295726776,
      "pose_mae_dy": 0.05755840986967087,
      "pose_rmse_dtheta": 0.3643323481082916,
      "pose_rmse_dx": 0.16342946887016296,
      "pose_rmse_dy": 0.14402075111865997,
      "pose_rmse_mean": 0.22392752766609192,
      "rmse_dtheta": 0.04217468202114105,
      "rmse_dx": 0.019398009404540062,
      "rmse_dy": 0.009336072020232677,
      "rmse_mean": 0.02363625541329384,
      "rotation_flip": 0.008421052247285843,
      "sparse_tokens": 16560.0,
      "step": 4296,
      "turn_loss": 0.23826351761817932,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.1996376138264263,
      "grad_norm": 0.5262080430984497,
      "learning_rate": 7.24872095742033e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.010328172706067562,
      "mae_dx": 0.00151178112719208,
      "mae_dy": 0.0012387516908347607,
      "pose_mae_dtheta": 0.0742768719792366,
      "pose_mae_dx": 0.01608099788427353,
      "pose_mae_dy": 0.01701645366847515,
      "pose_rmse_dtheta": 0.23367121815681458,
      "pose_rmse_dx": 0.03746768459677696,
      "pose_rmse_dy": 0.04305557161569595,
      "pose_rmse_mean": 0.1047314926981926,
      "rmse_dtheta": 0.026981394737958908,
      "rmse_dx": 0.0044366163201630116,
      "rmse_dy": 0.0027403461281210184,
      "rmse_mean": 0.011386118829250336,
      "rotation_flip": 0.0037205456756055355,
      "sparse_tokens": 32169.0,
      "step": 4297,
      "turn_loss": 0.06669875979423523,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.19968407359226908,
      "grad_norm": 0.618196427822113,
      "learning_rate": 7.2475399289907326e-06,
      "loss": 0.1504,
      "mae_dtheta": 0.04135103151202202,
      "mae_dx": 0.01201267447322607,
      "mae_dy": 0.0035031696315854788,
      "pose_mae_dtheta": 0.3555622398853302,
      "pose_mae_dx": 0.08920875936746597,
      "pose_mae_dy": 0.036032259464263916,
      "pose_rmse_dtheta": 0.6344135403633118,
      "pose_rmse_dx": 0.1813116818666458,
      "pose_rmse_dy": 0.10906513780355453,
      "pose_rmse_mean": 0.3082634508609772,
      "rmse_dtheta": 0.0642005130648613,
      "rmse_dx": 0.022111697122454643,
      "rmse_dy": 0.008316111750900745,
      "rmse_mean": 0.03154277801513672,
      "rotation_flip": 0.006550218444317579,
      "sparse_tokens": 7846.0,
      "step": 4298,
      "turn_loss": 0.26755332946777344,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.19973053335811186,
      "grad_norm": 0.4053484797477722,
      "learning_rate": 7.246358743389461e-06,
      "loss": 0.1088,
      "mae_dtheta": 0.01046042051166296,
      "mae_dx": 0.0015965617494657636,
      "mae_dy": 0.0021579077001661062,
      "pose_mae_dtheta": 0.07825817912817001,
      "pose_mae_dx": 0.02467069961130619,
      "pose_mae_dy": 0.030121468007564545,
      "pose_rmse_dtheta": 0.22560225427150726,
      "pose_rmse_dx": 0.066224105656147,
      "pose_rmse_dy": 0.07416728138923645,
      "pose_rmse_mean": 0.1219978854060173,
      "rmse_dtheta": 0.025202738121151924,
      "rmse_dx": 0.0049229832366108894,
      "rmse_dy": 0.005308911204338074,
      "rmse_mean": 0.011811545118689537,
      "rotation_flip": 0.00042372880852781236,
      "sparse_tokens": 32089.0,
      "step": 4299,
      "turn_loss": 0.0803724080324173,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.19977699312395467,
      "grad_norm": 0.5180150866508484,
      "learning_rate": 7.245177400699117e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.02759370021522045,
      "mae_dx": 0.00968390703201294,
      "mae_dy": 0.003992912359535694,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5180149674415588,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.32688903808594,
      "model/head/act_norm_mean": 124.3957851080247,
      "model/head/act_norm_min": 75.65191650390625,
      "model/head/act_over_embed": 85.48594813792351,
      "model/head/grad_frac": 0.10785741358995438,
      "model/head/grad_norm": 0.05587175488471985,
      "model/head/grad_zero_frac": 0.00017037494399119169,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6782045717592593,
      "model/head/update_ratio": 0.0009591304115019739,
      "model/head/weight_delta": 7.730884552001953,
      "model/head/weight_delta_rel": 0.13562262058258057,
      "model/head/weight_norm": 58.25251007080078,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41815587878227234,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41808942469154914,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41804617643356323,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.287314966862896,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09682142734527588,
      "model/modality_embedder.encoders.pose/grad_norm": 0.050154946744441986,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5346798780487805,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016238423995673656,
      "model/modality_embedder.encoders.pose/weight_delta": 2.539369821548462,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08296912908554077,
      "model/modality_embedder.encoders.pose/weight_norm": 30.886585235595703,
      "model/modality_embedder/grad_frac": 0.09682142734527588,
      "model/modality_embedder/grad_norm": 0.050154946744441986,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5346798780487805,
      "model/modality_embedder/update_ratio": 0.0016238423995673656,
      "model/modality_embedder/weight_delta": 2.539369821548462,
      "model/modality_embedder/weight_delta_rel": 0.08296912908554077,
      "model/modality_embedder/weight_norm": 30.886585235595703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.15316009521484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.918852880658438,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.993372917175293,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.124468993564754,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10022107511758804,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05191601812839508,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 8.574080129619688e-05,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001869652420282364,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.8417010307312012,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06711269915103912,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.767738342285156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.46531677246094,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.80109433176563,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.498503684997559,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.730753578440215,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.1051652655005455,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.054477181285619736,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001849789870902896,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.32861065864563,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08066489547491074,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.450469970703125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.17774200439453,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.494255829903977,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.249421119689941,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.89431001158858,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11109146475791931,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05754704028367996,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018928231438621879,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.5010035037994385,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08397901803255081,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.402755737304688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.01566314697266,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.36415772584754,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.4129056930542,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.179324100778363,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12640182673931122,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06547803431749344,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022042624186724424,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.134113073348999,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0729338601231575,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.705188751220703,
      "model/normalizer/grad_frac": 0.5212962627410889,
      "model/normalizer/grad_norm": 0.27003926038742065,
      "model/normalizer/grad_zero_frac": 0.00012880949361715466,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003448842093348503,
      "model/normalizer/weight_delta": 4.5334320068359375,
      "model/normalizer/weight_delta_rel": 0.05838797986507416,
      "model/normalizer/weight_norm": 78.29853057861328,
      "pose_mae_dtheta": 0.22491800785064697,
      "pose_mae_dx": 0.08821523934602737,
      "pose_mae_dy": 0.06141377612948418,
      "pose_rmse_dtheta": 0.4283975064754486,
      "pose_rmse_dx": 0.21796853840351105,
      "pose_rmse_dy": 0.1607123762369156,
      "pose_rmse_mean": 0.26902616024017334,
      "rmse_dtheta": 0.046677570790052414,
      "rmse_dx": 0.0224800743162632,
      "rmse_dy": 0.007905899547040462,
      "rmse_mean": 0.025687849149107933,
      "rotation_flip": 0.009230769239366055,
      "sparse_tokens": 20238.0,
      "step": 4300,
      "turn_loss": 0.20742295682430267,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.19982345288979744,
      "grad_norm": 0.49575215578079224,
      "learning_rate": 7.243995901002312e-06,
      "loss": 0.0814,
      "mae_dtheta": 0.008142380975186825,
      "mae_dx": 0.0019631574396044016,
      "mae_dy": 0.0018105057533830404,
      "pose_mae_dtheta": 0.06362994015216827,
      "pose_mae_dx": 0.020405057817697525,
      "pose_mae_dy": 0.023674340918660164,
      "pose_rmse_dtheta": 0.178267240524292,
      "pose_rmse_dx": 0.06652915477752686,
      "pose_rmse_dy": 0.062235694378614426,
      "pose_rmse_mean": 0.10234402865171432,
      "rmse_dtheta": 0.02022581174969673,
      "rmse_dx": 0.006903798319399357,
      "rmse_dy": 0.004280996508896351,
      "rmse_mean": 0.010470202192664146,
      "rotation_flip": 0.005949656944721937,
      "sparse_tokens": 32137.0,
      "step": 4301,
      "turn_loss": 0.05740083009004593,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.19986991265564022,
      "grad_norm": 0.5053912997245789,
      "learning_rate": 7.24281424438167e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.014690264128148556,
      "mae_dx": 0.0035534105263650417,
      "mae_dy": 0.0041028414852917194,
      "pose_mae_dtheta": 0.10725276172161102,
      "pose_mae_dx": 0.03617515414953232,
      "pose_mae_dy": 0.04429114982485771,
      "pose_rmse_dtheta": 0.2296333760023117,
      "pose_rmse_dx": 0.0857006162405014,
      "pose_rmse_dy": 0.1159326508641243,
      "pose_rmse_mean": 0.14375555515289307,
      "rmse_dtheta": 0.02796153351664543,
      "rmse_dx": 0.009985930286347866,
      "rmse_dy": 0.009014778770506382,
      "rmse_mean": 0.015654081478714943,
      "rotation_flip": 0.005315379239618778,
      "sparse_tokens": 32137.0,
      "step": 4302,
      "turn_loss": 0.13810065388679504,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.199916372421483,
      "grad_norm": 0.4795282483100891,
      "learning_rate": 7.241632430919823e-06,
      "loss": 0.165,
      "mae_dtheta": 0.03552199527621269,
      "mae_dx": 0.012904119677841663,
      "mae_dy": 0.0049825990572571754,
      "pose_mae_dtheta": 0.2663620114326477,
      "pose_mae_dx": 0.11222141981124878,
      "pose_mae_dy": 0.05796349048614502,
      "pose_rmse_dtheta": 0.46736621856689453,
      "pose_rmse_dx": 0.2423287183046341,
      "pose_rmse_dy": 0.12718011438846588,
      "pose_rmse_mean": 0.27895835041999817,
      "rmse_dtheta": 0.05309516564011574,
      "rmse_dx": 0.025839215144515038,
      "rmse_dy": 0.008869846351444721,
      "rmse_mean": 0.02926807664334774,
      "rotation_flip": 0.009135629050433636,
      "sparse_tokens": 22577.0,
      "step": 4303,
      "turn_loss": 0.2939281165599823,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.19996283218732577,
      "grad_norm": 0.46795421838760376,
      "learning_rate": 7.240450460699418e-06,
      "loss": 0.1427,
      "mae_dtheta": 0.013539626263082027,
      "mae_dx": 0.002010054886341095,
      "mae_dy": 0.0038655430544167757,
      "pose_mae_dtheta": 0.08791110664606094,
      "pose_mae_dx": 0.030630553141236305,
      "pose_mae_dy": 0.04048238322138786,
      "pose_rmse_dtheta": 0.1874183863401413,
      "pose_rmse_dx": 0.06991931796073914,
      "pose_rmse_dy": 0.08123115450143814,
      "pose_rmse_mean": 0.11285628378391266,
      "rmse_dtheta": 0.025814011693000793,
      "rmse_dx": 0.005448807496577501,
      "rmse_dy": 0.007621948607265949,
      "rmse_mean": 0.01296158879995346,
      "rotation_flip": 0.007243990898132324,
      "sparse_tokens": 32073.0,
      "step": 4304,
      "turn_loss": 0.12557677924633026,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.20000929195316855,
      "grad_norm": 0.4468280076980591,
      "learning_rate": 7.239268333803109e-06,
      "loss": 0.1231,
      "mae_dtheta": 0.04662146046757698,
      "mae_dx": 0.011572887189686298,
      "mae_dy": 0.006206657737493515,
      "pose_mae_dtheta": 0.35870248079299927,
      "pose_mae_dx": 0.0999847799539566,
      "pose_mae_dy": 0.07323706150054932,
      "pose_rmse_dtheta": 0.5969194173812866,
      "pose_rmse_dx": 0.2329472005367279,
      "pose_rmse_dy": 0.1823076456785202,
      "pose_rmse_mean": 0.3373914361000061,
      "rmse_dtheta": 0.0647822842001915,
      "rmse_dx": 0.02528074011206627,
      "rmse_dy": 0.01165424007922411,
      "rmse_mean": 0.0339057557284832,
      "rotation_flip": 0.00668151443824172,
      "sparse_tokens": 7462.0,
      "step": 4305,
      "turn_loss": 0.2729227542877197,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20005575171901133,
      "grad_norm": 0.6066563725471497,
      "learning_rate": 7.238086050313563e-06,
      "loss": 0.1405,
      "mae_dtheta": 0.016975775361061096,
      "mae_dx": 0.003290874417871237,
      "mae_dy": 0.004620148800313473,
      "pose_mae_dtheta": 0.12011406570672989,
      "pose_mae_dx": 0.03811969235539436,
      "pose_mae_dy": 0.04727189242839813,
      "pose_rmse_dtheta": 0.2654959559440613,
      "pose_rmse_dx": 0.0961957722902298,
      "pose_rmse_dy": 0.09932020306587219,
      "pose_rmse_mean": 0.15367063879966736,
      "rmse_dtheta": 0.03272970765829086,
      "rmse_dx": 0.009970485232770443,
      "rmse_dy": 0.009627116844058037,
      "rmse_mean": 0.01744243875145912,
      "rotation_flip": 0.0030895983800292015,
      "sparse_tokens": 32089.0,
      "step": 4306,
      "turn_loss": 0.1485767513513565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 38495.0,
      "epoch": 0.2001022114848541,
      "grad_norm": 0.5113101601600647,
      "learning_rate": 7.236903610313459e-06,
      "loss": 0.1251,
      "mae_dtheta": 0.021229932084679604,
      "mae_dx": 0.013273020274937153,
      "mae_dy": 0.005864998325705528,
      "pose_mae_dtheta": 0.18441474437713623,
      "pose_mae_dx": 0.1152312383055687,
      "pose_mae_dy": 0.07545831054449081,
      "pose_rmse_dtheta": 0.3461056053638458,
      "pose_rmse_dx": 0.2694747745990753,
      "pose_rmse_dy": 0.17911051213741302,
      "pose_rmse_mean": 0.2648969888687134,
      "rmse_dtheta": 0.036627791821956635,
      "rmse_dx": 0.027416981756687164,
      "rmse_dy": 0.013870085589587688,
      "rmse_mean": 0.02597161941230297,
      "rotation_flip": 0.006814309861510992,
      "sparse_tokens": 26084.0,
      "step": 4307,
      "turn_loss": 0.2320602536201477,
      "turns": 119.0,
      "turns_per_sample": 119.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2001486712506969,
      "grad_norm": 0.5918551087379456,
      "learning_rate": 7.2357210138854865e-06,
      "loss": 0.127,
      "mae_dtheta": 0.012468507513403893,
      "mae_dx": 0.0024550079833716154,
      "mae_dy": 0.002736395923420787,
      "pose_mae_dtheta": 0.08480332046747208,
      "pose_mae_dx": 0.025599829852581024,
      "pose_mae_dy": 0.02671338990330696,
      "pose_rmse_dtheta": 0.23391224443912506,
      "pose_rmse_dx": 0.056119080632925034,
      "pose_rmse_dy": 0.05642487853765488,
      "pose_rmse_mean": 0.11548539996147156,
      "rmse_dtheta": 0.02871572971343994,
      "rmse_dx": 0.006967628840357065,
      "rmse_dy": 0.005651627667248249,
      "rmse_mean": 0.013778328895568848,
      "rotation_flip": 0.004385964944958687,
      "sparse_tokens": 32169.0,
      "step": 4308,
      "turn_loss": 0.09690073132514954,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.20019513101653968,
      "grad_norm": 0.4604509174823761,
      "learning_rate": 7.234538261112342e-06,
      "loss": 0.1338,
      "mae_dtheta": 0.015692800283432007,
      "mae_dx": 0.003089613514021039,
      "mae_dy": 0.004161279182881117,
      "pose_mae_dtheta": 0.11343451589345932,
      "pose_mae_dx": 0.03190327063202858,
      "pose_mae_dy": 0.036126673221588135,
      "pose_rmse_dtheta": 0.27116236090660095,
      "pose_rmse_dx": 0.07772715389728546,
      "pose_rmse_dy": 0.07840360701084137,
      "pose_rmse_mean": 0.14243105053901672,
      "rmse_dtheta": 0.031564466655254364,
      "rmse_dx": 0.008836244232952595,
      "rmse_dy": 0.009216279722750187,
      "rmse_mean": 0.016538996249437332,
      "rotation_flip": 0.010177157819271088,
      "sparse_tokens": 32137.0,
      "step": 4309,
      "turn_loss": 0.13642047345638275,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20024159078238246,
      "grad_norm": 0.4539048671722412,
      "learning_rate": 7.233355352076736e-06,
      "loss": 0.1103,
      "mae_dtheta": 0.014250034466385841,
      "mae_dx": 0.0030373865738511086,
      "mae_dy": 0.00416646059602499,
      "pose_mae_dtheta": 0.10250824689865112,
      "pose_mae_dx": 0.03732820227742195,
      "pose_mae_dy": 0.040874503552913666,
      "pose_rmse_dtheta": 0.24183326959609985,
      "pose_rmse_dx": 0.10643315315246582,
      "pose_rmse_dy": 0.08925509452819824,
      "pose_rmse_mean": 0.14584051072597504,
      "rmse_dtheta": 0.027939917519688606,
      "rmse_dx": 0.00872620940208435,
      "rmse_dy": 0.009055963717401028,
      "rmse_mean": 0.01524069719016552,
      "rotation_flip": 0.005670446902513504,
      "sparse_tokens": 32073.0,
      "step": 4310,
      "turn_loss": 0.1274130642414093,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.20028805054822524,
      "grad_norm": 0.6595177054405212,
      "learning_rate": 7.232172286861394e-06,
      "loss": 0.1516,
      "mae_dtheta": 0.04996635019779205,
      "mae_dx": 0.014991549775004387,
      "mae_dy": 0.006712227128446102,
      "pose_mae_dtheta": 0.4192880094051361,
      "pose_mae_dx": 0.1375463753938675,
      "pose_mae_dy": 0.07318420708179474,
      "pose_rmse_dtheta": 0.6635363101959229,
      "pose_rmse_dx": 0.276808500289917,
      "pose_rmse_dy": 0.18894264101982117,
      "pose_rmse_mean": 0.37642917037010193,
      "rmse_dtheta": 0.06829292327165604,
      "rmse_dx": 0.027589265257120132,
      "rmse_dy": 0.014122550375759602,
      "rmse_mean": 0.03666824847459793,
      "rotation_flip": 0.009307135827839375,
      "sparse_tokens": 16230.0,
      "step": 4311,
      "turn_loss": 0.32360413670539856,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.20033451031406802,
      "grad_norm": 0.4701484441757202,
      "learning_rate": 7.2309890655490446e-06,
      "loss": 0.1238,
      "mae_dtheta": 0.011150344274938107,
      "mae_dx": 0.0022596532944589853,
      "mae_dy": 0.0025259368121623993,
      "pose_mae_dtheta": 0.07702021300792694,
      "pose_mae_dx": 0.024962881579995155,
      "pose_mae_dy": 0.03199198842048645,
      "pose_rmse_dtheta": 0.1558539718389511,
      "pose_rmse_dx": 0.05463940650224686,
      "pose_rmse_dy": 0.07549238204956055,
      "pose_rmse_mean": 0.09532859176397324,
      "rmse_dtheta": 0.021795649081468582,
      "rmse_dx": 0.0062330723740160465,
      "rmse_dy": 0.0048079597763717175,
      "rmse_mean": 0.010945560410618782,
      "rotation_flip": 0.0038924275431782007,
      "sparse_tokens": 32169.0,
      "step": 4312,
      "turn_loss": 0.10787583142518997,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.2003809700799108,
      "grad_norm": 0.4799050986766815,
      "learning_rate": 7.229805688222432e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.02804708480834961,
      "mae_dx": 0.0107435816898942,
      "mae_dy": 0.00566272484138608,
      "pose_mae_dtheta": 0.20876272022724152,
      "pose_mae_dx": 0.08865998685359955,
      "pose_mae_dy": 0.04953513666987419,
      "pose_rmse_dtheta": 0.4107625484466553,
      "pose_rmse_dx": 0.20307429134845734,
      "pose_rmse_dy": 0.12308377772569656,
      "pose_rmse_mean": 0.24564020335674286,
      "rmse_dtheta": 0.04674911871552467,
      "rmse_dx": 0.02324821613729,
      "rmse_dy": 0.011078553274273872,
      "rmse_mean": 0.027025295421481133,
      "rotation_flip": 0.009345794096589088,
      "sparse_tokens": 9046.0,
      "step": 4313,
      "turn_loss": 0.2552542984485626,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.20042742984575357,
      "grad_norm": 0.4020712077617645,
      "learning_rate": 7.228622154964312e-06,
      "loss": 0.0907,
      "mae_dtheta": 0.013078066520392895,
      "mae_dx": 0.002194736385717988,
      "mae_dy": 0.003565526334568858,
      "pose_mae_dtheta": 0.08445599675178528,
      "pose_mae_dx": 0.028415285050868988,
      "pose_mae_dy": 0.043603621423244476,
      "pose_rmse_dtheta": 0.15457648038864136,
      "pose_rmse_dx": 0.06551703065633774,
      "pose_rmse_dy": 0.10053853690624237,
      "pose_rmse_mean": 0.10687734931707382,
      "rmse_dtheta": 0.02259085699915886,
      "rmse_dx": 0.006647043861448765,
      "rmse_dy": 0.007975664921104908,
      "rmse_mean": 0.01240452192723751,
      "rotation_flip": 0.004000000189989805,
      "sparse_tokens": 32057.0,
      "step": 4314,
      "turn_loss": 0.12239335477352142,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.20047388961159635,
      "grad_norm": 0.4991970360279083,
      "learning_rate": 7.227438465857448e-06,
      "loss": 0.108,
      "mae_dtheta": 0.005493995733559132,
      "mae_dx": 0.001132805715315044,
      "mae_dy": 0.0005866237916052341,
      "pose_mae_dtheta": 0.040705084800720215,
      "pose_mae_dx": 0.01021308172494173,
      "pose_mae_dy": 0.010499516502022743,
      "pose_rmse_dtheta": 0.16127386689186096,
      "pose_rmse_dx": 0.02489297091960907,
      "pose_rmse_dy": 0.029640913009643555,
      "pose_rmse_mean": 0.07193592190742493,
      "rmse_dtheta": 0.018898271024227142,
      "rmse_dx": 0.0034002703614532948,
      "rmse_dy": 0.0012268949067220092,
      "rmse_mean": 0.007841812446713448,
      "rotation_flip": 0.0009779951069504023,
      "sparse_tokens": 32153.0,
      "step": 4315,
      "turn_loss": 0.03340960294008255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.20052034937743915,
      "grad_norm": 0.4704669117927551,
      "learning_rate": 7.226254620984617e-06,
      "loss": 0.1221,
      "mae_dtheta": 0.034245625138282776,
      "mae_dx": 0.007609754800796509,
      "mae_dy": 0.006000854540616274,
      "pose_mae_dtheta": 0.27145418524742126,
      "pose_mae_dx": 0.08385937660932541,
      "pose_mae_dy": 0.06267140060663223,
      "pose_rmse_dtheta": 0.4281383752822876,
      "pose_rmse_dx": 0.20364680886268616,
      "pose_rmse_dy": 0.12322542816400528,
      "pose_rmse_mean": 0.2516702115535736,
      "rmse_dtheta": 0.04820985719561577,
      "rmse_dx": 0.019436215981841087,
      "rmse_dy": 0.010143553838133812,
      "rmse_mean": 0.025929875671863556,
      "rotation_flip": 0.014234875328838825,
      "sparse_tokens": 5289.0,
      "step": 4316,
      "turn_loss": 0.28976383805274963,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.20056680914328193,
      "grad_norm": 0.5703562498092651,
      "learning_rate": 7.225070620428605e-06,
      "loss": 0.1102,
      "mae_dtheta": 0.026802795007824898,
      "mae_dx": 0.012402074411511421,
      "mae_dy": 0.005230692680925131,
      "pose_mae_dtheta": 0.20134420692920685,
      "pose_mae_dx": 0.09804343432188034,
      "pose_mae_dy": 0.06645254045724869,
      "pose_rmse_dtheta": 0.3491704761981964,
      "pose_rmse_dx": 0.2171422243118286,
      "pose_rmse_dy": 0.14972363412380219,
      "pose_rmse_mean": 0.23867878317832947,
      "rmse_dtheta": 0.04090820997953415,
      "rmse_dx": 0.024341143667697906,
      "rmse_dy": 0.009789971634745598,
      "rmse_mean": 0.025013109669089317,
      "rotation_flip": 0.01103309914469719,
      "sparse_tokens": 16491.0,
      "step": 4317,
      "turn_loss": 0.21326926350593567,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 36226.0,
      "epoch": 0.2006132689091247,
      "grad_norm": 0.9486129879951477,
      "learning_rate": 7.2238864642722106e-06,
      "loss": 0.3269,
      "mae_dtheta": 0.04284802824258804,
      "mae_dx": 0.01330314576625824,
      "mae_dy": 0.009639767929911613,
      "pose_mae_dtheta": 0.3324897289276123,
      "pose_mae_dx": 0.11929919570684433,
      "pose_mae_dy": 0.09909660369157791,
      "pose_rmse_dtheta": 0.5518446564674377,
      "pose_rmse_dx": 0.23753993213176727,
      "pose_rmse_dy": 0.22042299807071686,
      "pose_rmse_mean": 0.3366025388240814,
      "rmse_dtheta": 0.06107687950134277,
      "rmse_dx": 0.02526627480983734,
      "rmse_dy": 0.018058886751532555,
      "rmse_mean": 0.034800682216882706,
      "rotation_flip": 0.014814814552664757,
      "sparse_tokens": 27492.0,
      "step": 4318,
      "turn_loss": 0.3721335828304291,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 11057.0,
      "epoch": 0.20065972867496748,
      "grad_norm": 0.4667935073375702,
      "learning_rate": 7.222702152598242e-06,
      "loss": 0.1052,
      "mae_dtheta": 0.03566175699234009,
      "mae_dx": 0.011200872249901295,
      "mae_dy": 0.005031366366893053,
      "pose_mae_dtheta": 0.27731770277023315,
      "pose_mae_dx": 0.08808644860982895,
      "pose_mae_dy": 0.03782627359032631,
      "pose_rmse_dtheta": 0.5175700783729553,
      "pose_rmse_dx": 0.18974055349826813,
      "pose_rmse_dy": 0.07803815603256226,
      "pose_rmse_mean": 0.2617829442024231,
      "rmse_dtheta": 0.05448096990585327,
      "rmse_dx": 0.021943138912320137,
      "rmse_dy": 0.010554011911153793,
      "rmse_mean": 0.028992708772420883,
      "rotation_flip": 0.01006036251783371,
      "sparse_tokens": 9324.0,
      "step": 4319,
      "turn_loss": 0.29513999819755554,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.20070618844081026,
      "grad_norm": 0.662369430065155,
      "learning_rate": 7.221517685489519e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.00991373136639595,
      "mae_dx": 0.0023407009430229664,
      "mae_dy": 0.002213064581155777,
      "pose_mae_dtheta": 0.07214830070734024,
      "pose_mae_dx": 0.016257384791970253,
      "pose_mae_dy": 0.018354253843426704,
      "pose_rmse_dtheta": 0.24564394354820251,
      "pose_rmse_dx": 0.04604514315724373,
      "pose_rmse_dy": 0.04692304506897926,
      "pose_rmse_mean": 0.1128707155585289,
      "rmse_dtheta": 0.027880849316716194,
      "rmse_dx": 0.008980314247310162,
      "rmse_dy": 0.007724604569375515,
      "rmse_mean": 0.014861922711133957,
      "rotation_flip": 0.005045408848673105,
      "sparse_tokens": 32137.0,
      "step": 4320,
      "turn_loss": 0.07785303890705109,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.20075264820665303,
      "grad_norm": 0.4025621712207794,
      "learning_rate": 7.2203330630288714e-06,
      "loss": 0.1031,
      "mae_dtheta": 0.03276732191443443,
      "mae_dx": 0.01080079935491085,
      "mae_dy": 0.004848871845752001,
      "pose_mae_dtheta": 0.23322804272174835,
      "pose_mae_dx": 0.07544702291488647,
      "pose_mae_dy": 0.05283834785223007,
      "pose_rmse_dtheta": 0.42977023124694824,
      "pose_rmse_dx": 0.16401690244674683,
      "pose_rmse_dy": 0.11083617806434631,
      "pose_rmse_mean": 0.23487445712089539,
      "rmse_dtheta": 0.049980711191892624,
      "rmse_dx": 0.02274887077510357,
      "rmse_dy": 0.009366815909743309,
      "rmse_mean": 0.027365466579794884,
      "rotation_flip": 0.00705645140260458,
      "sparse_tokens": 16089.0,
      "step": 4321,
      "turn_loss": 0.27861568331718445,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.2007991079724958,
      "grad_norm": 0.7099542021751404,
      "learning_rate": 7.219148285299142e-06,
      "loss": 0.1399,
      "mae_dtheta": 0.03696668893098831,
      "mae_dx": 0.012866448611021042,
      "mae_dy": 0.00865466520190239,
      "pose_mae_dtheta": 0.2687692940235138,
      "pose_mae_dx": 0.106253482401371,
      "pose_mae_dy": 0.08858241140842438,
      "pose_rmse_dtheta": 0.46814092993736267,
      "pose_rmse_dx": 0.23739434778690338,
      "pose_rmse_dy": 0.24519255757331848,
      "pose_rmse_mean": 0.3169092833995819,
      "rmse_dtheta": 0.0552644282579422,
      "rmse_dx": 0.025237662717700005,
      "rmse_dy": 0.018879707902669907,
      "rmse_mean": 0.03312727063894272,
      "rotation_flip": 0.01568627543747425,
      "sparse_tokens": 7883.0,
      "step": 4322,
      "turn_loss": 0.3494722843170166,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.2008455677383386,
      "grad_norm": 0.8607315421104431,
      "learning_rate": 7.217963352383182e-06,
      "loss": 0.1899,
      "mae_dtheta": 0.027085524052381516,
      "mae_dx": 0.01401744969189167,
      "mae_dy": 0.005933385342359543,
      "pose_mae_dtheta": 0.18521848320960999,
      "pose_mae_dx": 0.11327705532312393,
      "pose_mae_dy": 0.05836537852883339,
      "pose_rmse_dtheta": 0.35090383887290955,
      "pose_rmse_dx": 0.2608727514743805,
      "pose_rmse_dy": 0.13677559792995453,
      "pose_rmse_mean": 0.24951741099357605,
      "rmse_dtheta": 0.04395747184753418,
      "rmse_dx": 0.02799086831510067,
      "rmse_dy": 0.011964457109570503,
      "rmse_mean": 0.02797093242406845,
      "rotation_flip": 0.020348837599158287,
      "sparse_tokens": 18998.0,
      "step": 4323,
      "turn_loss": 0.2318134307861328,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2008920275041814,
      "grad_norm": 0.5215232372283936,
      "learning_rate": 7.216778264363853e-06,
      "loss": 0.1481,
      "mae_dtheta": 0.011162867769598961,
      "mae_dx": 0.0014057845110073686,
      "mae_dy": 0.002336616162210703,
      "pose_mae_dtheta": 0.07545708864927292,
      "pose_mae_dx": 0.021295854821801186,
      "pose_mae_dy": 0.028936590999364853,
      "pose_rmse_dtheta": 0.15393775701522827,
      "pose_rmse_dx": 0.05050152912735939,
      "pose_rmse_dy": 0.06331819295883179,
      "pose_rmse_mean": 0.08925249427556992,
      "rmse_dtheta": 0.02112857811152935,
      "rmse_dx": 0.003991748671978712,
      "rmse_dy": 0.004560529720038176,
      "rmse_mean": 0.009893619455397129,
      "rotation_flip": 0.005145167000591755,
      "sparse_tokens": 32105.0,
      "step": 4324,
      "turn_loss": 0.08571308106184006,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20093848727002417,
      "grad_norm": 0.5177488327026367,
      "learning_rate": 7.215593021324029e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.009551909752190113,
      "mae_dx": 0.0015943452017381787,
      "mae_dy": 0.0017754662549123168,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5177488923072815,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.39366149902344,
      "model/head/act_norm_mean": 116.85902975063131,
      "model/head/act_norm_min": 62.08711624145508,
      "model/head/act_over_embed": 80.30661929610743,
      "model/head/grad_frac": 0.09453889727592468,
      "model/head/grad_norm": 0.04894740879535675,
      "model/head/grad_zero_frac": 0.00016466404485981911,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6999043166035354,
      "model/head/update_ratio": 0.0008401974337175488,
      "model/head/weight_delta": 7.750853061676025,
      "model/head/weight_delta_rel": 0.13597291707992554,
      "model/head/weight_norm": 58.25703048706055,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4183208644390106,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41824957442610233,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41818326711654663,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2874250232598264,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06449560075998306,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0333925262093544,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.54255850456621,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010810786625370383,
      "model/modality_embedder.encoders.pose/weight_delta": 2.549055576324463,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08328559249639511,
      "model/modality_embedder.encoders.pose/weight_norm": 30.888154983520508,
      "model/modality_embedder/grad_frac": 0.06449560075998306,
      "model/modality_embedder/grad_norm": 0.0333925262093544,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.54255850456621,
      "model/modality_embedder/update_ratio": 0.0010810786625370383,
      "model/modality_embedder/weight_delta": 2.549055576324463,
      "model/modality_embedder/weight_delta_rel": 0.08328559249639511,
      "model/modality_embedder/weight_norm": 30.888154983520508,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.14224243164062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.206008497675164,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.038541793823242,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.634595659824388,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08040562272071838,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04162992164492607,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001499159843660891,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.8489444255828857,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06737665086984634,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.768835067749023,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.34883880615234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.2228059363476,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.364855766296387,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.33334837908769,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0861663892865181,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04461255297064781,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015146733494475484,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.338179588317871,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08099637180566788,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.453580856323242,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.97838592529297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.127743205868207,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.551581382751465,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.64243910500595,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09837532043457031,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05093371495604515,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001675110892392695,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.5114858150482178,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08433099091053009,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.40617561340332,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.2702407836914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.897982804232804,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.329928398132324,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.858964330246337,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12390652298927307,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06415246427059174,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 8.069722389336675e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002159447642043233,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.143449544906616,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07325293123722076,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.70781135559082,
      "model/normalizer/grad_frac": 0.5106529593467712,
      "model/normalizer/grad_norm": 0.2643899917602539,
      "model/normalizer/grad_zero_frac": 0.00013826339272782207,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003376543987542391,
      "model/normalizer/weight_delta": 4.552368640899658,
      "model/normalizer/weight_delta_rel": 0.05863187089562416,
      "model/normalizer/weight_norm": 78.30195617675781,
      "pose_mae_dtheta": 0.061960671097040176,
      "pose_mae_dx": 0.017592186108231544,
      "pose_mae_dy": 0.020873097702860832,
      "pose_rmse_dtheta": 0.19385553896427155,
      "pose_rmse_dx": 0.05359984561800957,
      "pose_rmse_dy": 0.06447921693325043,
      "pose_rmse_mean": 0.10397820174694061,
      "rmse_dtheta": 0.024287838488817215,
      "rmse_dx": 0.005496084690093994,
      "rmse_dy": 0.004612520802766085,
      "rmse_mean": 0.011465481482446194,
      "rotation_flip": 0.007936508394777775,
      "sparse_tokens": 32073.0,
      "step": 4325,
      "turn_loss": 0.0664372369647026,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.20098494703586695,
      "grad_norm": 0.7030625939369202,
      "learning_rate": 7.2144076233465976e-06,
      "loss": 0.2083,
      "mae_dtheta": 0.03396990895271301,
      "mae_dx": 0.01536946278065443,
      "mae_dy": 0.00808571744710207,
      "pose_mae_dtheta": 0.24161605536937714,
      "pose_mae_dx": 0.1315716803073883,
      "pose_mae_dy": 0.07934439927339554,
      "pose_rmse_dtheta": 0.42474815249443054,
      "pose_rmse_dx": 0.27676889300346375,
      "pose_rmse_dy": 0.21817506849765778,
      "pose_rmse_mean": 0.3065640330314636,
      "rmse_dtheta": 0.05146981030702591,
      "rmse_dx": 0.02823694422841072,
      "rmse_dy": 0.01815100945532322,
      "rmse_mean": 0.032619256526231766,
      "rotation_flip": 0.012799999676644802,
      "sparse_tokens": 20839.0,
      "step": 4326,
      "turn_loss": 0.36954736709594727,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.20103140680170972,
      "grad_norm": 0.5583561658859253,
      "learning_rate": 7.213222070514453e-06,
      "loss": 0.1238,
      "mae_dtheta": 0.03415993973612785,
      "mae_dx": 0.02072785049676895,
      "mae_dy": 0.004106971435248852,
      "pose_mae_dtheta": 0.28319594264030457,
      "pose_mae_dx": 0.1841251105070114,
      "pose_mae_dy": 0.06846432387828827,
      "pose_rmse_dtheta": 0.47082769870758057,
      "pose_rmse_dx": 0.36281338334083557,
      "pose_rmse_dy": 0.16114239394664764,
      "pose_rmse_mean": 0.3315944969654083,
      "rmse_dtheta": 0.04966476187109947,
      "rmse_dx": 0.03529809042811394,
      "rmse_dy": 0.008458273485302925,
      "rmse_mean": 0.03114037588238716,
      "rotation_flip": 0.009589040651917458,
      "sparse_tokens": 14510.0,
      "step": 4327,
      "turn_loss": 0.2686697840690613,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 34064.0,
      "epoch": 0.2010778665675525,
      "grad_norm": 0.6849350929260254,
      "learning_rate": 7.2120363629104996e-06,
      "loss": 0.2162,
      "mae_dtheta": 0.02965151146054268,
      "mae_dx": 0.01215649489313364,
      "mae_dy": 0.003479135688394308,
      "pose_mae_dtheta": 0.22222797572612762,
      "pose_mae_dx": 0.09809049218893051,
      "pose_mae_dy": 0.04199732467532158,
      "pose_rmse_dtheta": 0.3766739070415497,
      "pose_rmse_dx": 0.23263044655323029,
      "pose_rmse_dy": 0.10462059080600739,
      "pose_rmse_mean": 0.23797498643398285,
      "rmse_dtheta": 0.04508268088102341,
      "rmse_dx": 0.0252685546875,
      "rmse_dy": 0.007046750281006098,
      "rmse_mean": 0.025799330323934555,
      "rotation_flip": 0.016925247386097908,
      "sparse_tokens": 26633.0,
      "step": 4328,
      "turn_loss": 0.27469345927238464,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.20112432633339528,
      "grad_norm": 0.4843842387199402,
      "learning_rate": 7.2108505006176576e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.010952617041766644,
      "mae_dx": 0.001790153095498681,
      "mae_dy": 0.0021391352638602257,
      "pose_mae_dtheta": 0.07734272629022598,
      "pose_mae_dx": 0.022435592487454414,
      "pose_mae_dy": 0.029833434149622917,
      "pose_rmse_dtheta": 0.17837022244930267,
      "pose_rmse_dx": 0.05953620374202728,
      "pose_rmse_dy": 0.07822323590517044,
      "pose_rmse_mean": 0.10537655651569366,
      "rmse_dtheta": 0.023922953754663467,
      "rmse_dx": 0.004793163388967514,
      "rmse_dy": 0.004498782102018595,
      "rmse_mean": 0.01107163354754448,
      "rotation_flip": 0.00800290983170271,
      "sparse_tokens": 32169.0,
      "step": 4329,
      "turn_loss": 0.08060484379529953,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.20117078609923805,
      "grad_norm": 0.6429972052574158,
      "learning_rate": 7.209664483718852e-06,
      "loss": 0.1519,
      "mae_dtheta": 0.028743216767907143,
      "mae_dx": 0.013559066690504551,
      "mae_dy": 0.005872001405805349,
      "pose_mae_dtheta": 0.24575364589691162,
      "pose_mae_dx": 0.10254116356372833,
      "pose_mae_dy": 0.06524495035409927,
      "pose_rmse_dtheta": 0.44128841161727905,
      "pose_rmse_dx": 0.2283848524093628,
      "pose_rmse_dy": 0.15210221707820892,
      "pose_rmse_mean": 0.27392518520355225,
      "rmse_dtheta": 0.04523146525025368,
      "rmse_dx": 0.02578134648501873,
      "rmse_dy": 0.012760798446834087,
      "rmse_mean": 0.027924535796046257,
      "rotation_flip": 0.018003273755311966,
      "sparse_tokens": 11757.0,
      "step": 4330,
      "turn_loss": 0.23457235097885132,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.20121724586508083,
      "grad_norm": 0.4674428403377533,
      "learning_rate": 7.208478312297024e-06,
      "loss": 0.1338,
      "mae_dtheta": 0.012379062362015247,
      "mae_dx": 0.0021158899180591106,
      "mae_dy": 0.003098959568887949,
      "pose_mae_dtheta": 0.08618892729282379,
      "pose_mae_dx": 0.02730809897184372,
      "pose_mae_dy": 0.033758703619241714,
      "pose_rmse_dtheta": 0.2124771624803543,
      "pose_rmse_dx": 0.07535163313150406,
      "pose_rmse_dy": 0.07359781116247177,
      "pose_rmse_mean": 0.12047554552555084,
      "rmse_dtheta": 0.025919832289218903,
      "rmse_dx": 0.006007049232721329,
      "rmse_dy": 0.0073295217007398605,
      "rmse_mean": 0.013085467740893364,
      "rotation_flip": 0.003912363201379776,
      "sparse_tokens": 32105.0,
      "step": 4331,
      "turn_loss": 0.0914803296327591,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.20126370563092363,
      "grad_norm": 2.3972253799438477,
      "learning_rate": 7.2072919864351225e-06,
      "loss": 0.2378,
      "mae_dtheta": 0.02892535924911499,
      "mae_dx": 0.0050338758155703545,
      "mae_dy": 0.0032616211101412773,
      "pose_mae_dtheta": 0.20883183181285858,
      "pose_mae_dx": 0.04911970719695091,
      "pose_mae_dy": 0.03196136653423309,
      "pose_rmse_dtheta": 0.3661757707595825,
      "pose_rmse_dx": 0.12726616859436035,
      "pose_rmse_dy": 0.08355401456356049,
      "pose_rmse_mean": 0.19233199954032898,
      "rmse_dtheta": 0.046598635613918304,
      "rmse_dx": 0.013461621478199959,
      "rmse_dy": 0.007392179686576128,
      "rmse_mean": 0.022484146058559418,
      "rotation_flip": 0.01312335953116417,
      "sparse_tokens": 6862.0,
      "step": 4332,
      "turn_loss": 0.238973006606102,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.2013101653967664,
      "grad_norm": 0.5423725247383118,
      "learning_rate": 7.206105506216107e-06,
      "loss": 0.112,
      "mae_dtheta": 0.0236643198877573,
      "mae_dx": 0.012531974352896214,
      "mae_dy": 0.0016524556558579206,
      "pose_mae_dtheta": 0.20322567224502563,
      "pose_mae_dx": 0.09964707493782043,
      "pose_mae_dy": 0.028791150078177452,
      "pose_rmse_dtheta": 0.4388982653617859,
      "pose_rmse_dx": 0.2627826929092407,
      "pose_rmse_dy": 0.07621639966964722,
      "pose_rmse_mean": 0.2592991292476654,
      "rmse_dtheta": 0.04454130679368973,
      "rmse_dx": 0.027104955166578293,
      "rmse_dy": 0.0041784378699958324,
      "rmse_mean": 0.02527489885687828,
      "rotation_flip": 0.009646302089095116,
      "sparse_tokens": 10761.0,
      "step": 4333,
      "turn_loss": 0.24356092512607574,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2013566251626092,
      "grad_norm": 0.6885379552841187,
      "learning_rate": 7.20491887172295e-06,
      "loss": 0.1404,
      "mae_dtheta": 0.011817528866231441,
      "mae_dx": 0.002714867005124688,
      "mae_dy": 0.00275173201225698,
      "pose_mae_dtheta": 0.09673111885786057,
      "pose_mae_dx": 0.027399437502026558,
      "pose_mae_dy": 0.029047127813100815,
      "pose_rmse_dtheta": 0.2559463679790497,
      "pose_rmse_dx": 0.07686576247215271,
      "pose_rmse_dy": 0.07870641350746155,
      "pose_rmse_mean": 0.1371728479862213,
      "rmse_dtheta": 0.028687583282589912,
      "rmse_dx": 0.008261006325483322,
      "rmse_dy": 0.007656312081962824,
      "rmse_mean": 0.014868302270770073,
      "rotation_flip": 0.006617038976401091,
      "sparse_tokens": 32169.0,
      "step": 4334,
      "turn_loss": 0.0997280552983284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.20140308492845196,
      "grad_norm": 0.4730239510536194,
      "learning_rate": 7.203732083038633e-06,
      "loss": 0.1064,
      "mae_dtheta": 0.006528882309794426,
      "mae_dx": 0.0011545793386176229,
      "mae_dy": 0.0006435607792809606,
      "pose_mae_dtheta": 0.047163594514131546,
      "pose_mae_dx": 0.009834830649197102,
      "pose_mae_dy": 0.010117617435753345,
      "pose_rmse_dtheta": 0.18779760599136353,
      "pose_rmse_dx": 0.03380613774061203,
      "pose_rmse_dy": 0.023990022018551826,
      "pose_rmse_mean": 0.08186459541320801,
      "rmse_dtheta": 0.02331458404660225,
      "rmse_dx": 0.004127743653953075,
      "rmse_dy": 0.0017633483512327075,
      "rmse_mean": 0.009735225699841976,
      "rotation_flip": 0.002879769541323185,
      "sparse_tokens": 32121.0,
      "step": 4335,
      "turn_loss": 0.041279781609773636,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.20144954469429474,
      "grad_norm": 0.4202537536621094,
      "learning_rate": 7.202545140246148e-06,
      "loss": 0.0952,
      "mae_dtheta": 0.010496210306882858,
      "mae_dx": 0.0016662045381963253,
      "mae_dy": 0.0029995576478540897,
      "pose_mae_dtheta": 0.07253799587488174,
      "pose_mae_dx": 0.024376342073082924,
      "pose_mae_dy": 0.033721957355737686,
      "pose_rmse_dtheta": 0.15187810361385345,
      "pose_rmse_dx": 0.05640709400177002,
      "pose_rmse_dy": 0.06528657674789429,
      "pose_rmse_mean": 0.09119059890508652,
      "rmse_dtheta": 0.01924113743007183,
      "rmse_dx": 0.004458474460989237,
      "rmse_dy": 0.005541064776480198,
      "rmse_mean": 0.009746892377734184,
      "rotation_flip": 0.004620462190359831,
      "sparse_tokens": 32105.0,
      "step": 4336,
      "turn_loss": 0.08769673109054565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.20149600446013752,
      "grad_norm": 0.4914565980434418,
      "learning_rate": 7.201358043428499e-06,
      "loss": 0.1076,
      "mae_dtheta": 0.03618348389863968,
      "mae_dx": 0.014026938937604427,
      "mae_dy": 0.002357176039367914,
      "pose_mae_dtheta": 0.33410435914993286,
      "pose_mae_dx": 0.10386204719543457,
      "pose_mae_dy": 0.02233509160578251,
      "pose_rmse_dtheta": 0.4978066384792328,
      "pose_rmse_dx": 0.20662787556648254,
      "pose_rmse_dy": 0.043899014592170715,
      "pose_rmse_mean": 0.24944451451301575,
      "rmse_dtheta": 0.05031462386250496,
      "rmse_dx": 0.024610882624983788,
      "rmse_dy": 0.004819080699235201,
      "rmse_mean": 0.026581529527902603,
      "rotation_flip": 0.007380073890089989,
      "sparse_tokens": 5212.0,
      "step": 4337,
      "turn_loss": 0.2682797610759735,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.2015424642259803,
      "grad_norm": 0.4935145676136017,
      "learning_rate": 7.2001707926687e-06,
      "loss": 0.122,
      "mae_dtheta": 0.034825388342142105,
      "mae_dx": 0.013807952404022217,
      "mae_dy": 0.009741432964801788,
      "pose_mae_dtheta": 0.2865506708621979,
      "pose_mae_dx": 0.11216770112514496,
      "pose_mae_dy": 0.12025721371173859,
      "pose_rmse_dtheta": 0.466595321893692,
      "pose_rmse_dx": 0.23570191860198975,
      "pose_rmse_dy": 0.22177638113498688,
      "pose_rmse_mean": 0.308024525642395,
      "rmse_dtheta": 0.05009264871478081,
      "rmse_dx": 0.026593118906021118,
      "rmse_dy": 0.015198157168924809,
      "rmse_mean": 0.03062797710299492,
      "rotation_flip": 0.02023608796298504,
      "sparse_tokens": 10552.0,
      "step": 4338,
      "turn_loss": 0.33915138244628906,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.20158892399182307,
      "grad_norm": 0.3758750557899475,
      "learning_rate": 7.198983388049779e-06,
      "loss": 0.0641,
      "mae_dtheta": 0.009101097472012043,
      "mae_dx": 0.0016586987767368555,
      "mae_dy": 0.0016751281218603253,
      "pose_mae_dtheta": 0.05836009234189987,
      "pose_mae_dx": 0.020155522972345352,
      "pose_mae_dy": 0.020067952573299408,
      "pose_rmse_dtheta": 0.1406683325767517,
      "pose_rmse_dx": 0.048483431339263916,
      "pose_rmse_dy": 0.051370326429605484,
      "pose_rmse_mean": 0.0801740288734436,
      "rmse_dtheta": 0.02162167988717556,
      "rmse_dx": 0.004492813255637884,
      "rmse_dy": 0.003988025709986687,
      "rmse_mean": 0.010034173727035522,
      "rotation_flip": 0.003681885078549385,
      "sparse_tokens": 32185.0,
      "step": 4339,
      "turn_loss": 0.06775927543640137,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.20163538375766585,
      "grad_norm": 0.6645738482475281,
      "learning_rate": 7.1977958296547666e-06,
      "loss": 0.1645,
      "mae_dtheta": 0.0281706340610981,
      "mae_dx": 0.016952218487858772,
      "mae_dy": 0.0026809941045939922,
      "pose_mae_dtheta": 0.2380828559398651,
      "pose_mae_dx": 0.13054785132408142,
      "pose_mae_dy": 0.04461713135242462,
      "pose_rmse_dtheta": 0.4460781216621399,
      "pose_rmse_dx": 0.2896084785461426,
      "pose_rmse_dy": 0.09895475953817368,
      "pose_rmse_mean": 0.2782137989997864,
      "rmse_dtheta": 0.04621705412864685,
      "rmse_dx": 0.03106882981956005,
      "rmse_dy": 0.004832557402551174,
      "rmse_mean": 0.0273728147149086,
      "rotation_flip": 0.028368793427944183,
      "sparse_tokens": 5766.0,
      "step": 4340,
      "turn_loss": 0.26229310035705566,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 26607.0,
      "epoch": 0.20168184352350865,
      "grad_norm": 0.6468223929405212,
      "learning_rate": 7.196608117566714e-06,
      "loss": 0.1058,
      "mae_dtheta": 0.032865121960639954,
      "mae_dx": 0.00969004537910223,
      "mae_dy": 0.006262181326746941,
      "pose_mae_dtheta": 0.2602131962776184,
      "pose_mae_dx": 0.06687702238559723,
      "pose_mae_dy": 0.06752941012382507,
      "pose_rmse_dtheta": 0.5108139514923096,
      "pose_rmse_dx": 0.17598025500774384,
      "pose_rmse_dy": 0.20176982879638672,
      "pose_rmse_mean": 0.29618802666664124,
      "rmse_dtheta": 0.05459801107645035,
      "rmse_dx": 0.022160790860652924,
      "rmse_dy": 0.016091912984848022,
      "rmse_mean": 0.030950238928198814,
      "rotation_flip": 0.019147085025906563,
      "sparse_tokens": 20255.0,
      "step": 4341,
      "turn_loss": 0.22690865397453308,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.20172830328935143,
      "grad_norm": 0.5196589231491089,
      "learning_rate": 7.195420251868676e-06,
      "loss": 0.1446,
      "mae_dtheta": 0.03793901205062866,
      "mae_dx": 0.012882059440016747,
      "mae_dy": 0.005983363837003708,
      "pose_mae_dtheta": 0.27837443351745605,
      "pose_mae_dx": 0.08690185844898224,
      "pose_mae_dy": 0.07305289804935455,
      "pose_rmse_dtheta": 0.48276329040527344,
      "pose_rmse_dx": 0.203551784157753,
      "pose_rmse_dy": 0.17176111042499542,
      "pose_rmse_mean": 0.28602540493011475,
      "rmse_dtheta": 0.05479588359594345,
      "rmse_dx": 0.025371570140123367,
      "rmse_dy": 0.012658870778977871,
      "rmse_mean": 0.03094211034476757,
      "rotation_flip": 0.013224821537733078,
      "sparse_tokens": 15566.0,
      "step": 4342,
      "turn_loss": 0.30351412296295166,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2017747630551942,
      "grad_norm": 0.5017887949943542,
      "learning_rate": 7.194232232643721e-06,
      "loss": 0.15,
      "mae_dtheta": 0.008816610090434551,
      "mae_dx": 0.0012123603373765945,
      "mae_dy": 0.001506432075984776,
      "pose_mae_dtheta": 0.05772346258163452,
      "pose_mae_dx": 0.014406555332243443,
      "pose_mae_dy": 0.022424647584557533,
      "pose_rmse_dtheta": 0.16288979351520538,
      "pose_rmse_dx": 0.03778086230158806,
      "pose_rmse_dy": 0.04587890952825546,
      "pose_rmse_mean": 0.08218319714069366,
      "rmse_dtheta": 0.019848251715302467,
      "rmse_dx": 0.004087082110345364,
      "rmse_dy": 0.002734074369072914,
      "rmse_mean": 0.008889802731573582,
      "rotation_flip": 0.004268032498657703,
      "sparse_tokens": 32057.0,
      "step": 4343,
      "turn_loss": 0.062052153050899506,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.20182122282103698,
      "grad_norm": 0.5518477559089661,
      "learning_rate": 7.193044059974928e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.033568866550922394,
      "mae_dx": 0.013728401623666286,
      "mae_dy": 0.009032930247485638,
      "pose_mae_dtheta": 0.22389955818653107,
      "pose_mae_dx": 0.10640311241149902,
      "pose_mae_dy": 0.09505457431077957,
      "pose_rmse_dtheta": 0.3819729685783386,
      "pose_rmse_dx": 0.24625423550605774,
      "pose_rmse_dy": 0.2420012205839157,
      "pose_rmse_mean": 0.2900761663913727,
      "rmse_dtheta": 0.04996583238244057,
      "rmse_dx": 0.02549796923995018,
      "rmse_dy": 0.01930948533117771,
      "rmse_mean": 0.03159109503030777,
      "rotation_flip": 0.018786126747727394,
      "sparse_tokens": 10711.0,
      "step": 4344,
      "turn_loss": 0.3665847182273865,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.20186768258687976,
      "grad_norm": 0.44953304529190063,
      "learning_rate": 7.191855733945388e-06,
      "loss": 0.104,
      "mae_dtheta": 0.012771840207278728,
      "mae_dx": 0.0037983651272952557,
      "mae_dy": 0.003735938807949424,
      "pose_mae_dtheta": 0.08814345300197601,
      "pose_mae_dx": 0.048188310116529465,
      "pose_mae_dy": 0.040625978261232376,
      "pose_rmse_dtheta": 0.2010735422372818,
      "pose_rmse_dx": 0.13732776045799255,
      "pose_rmse_dy": 0.10158777981996536,
      "pose_rmse_mean": 0.14666303992271423,
      "rmse_dtheta": 0.025481630116701126,
      "rmse_dx": 0.011415758170187473,
      "rmse_dy": 0.008811013773083687,
      "rmse_mean": 0.015236134640872478,
      "rotation_flip": 0.0064047821797430515,
      "sparse_tokens": 32057.0,
      "step": 4345,
      "turn_loss": 0.11751848459243774,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.20191414235272254,
      "grad_norm": 0.6143754720687866,
      "learning_rate": 7.190667254638199e-06,
      "loss": 0.1648,
      "mae_dtheta": 0.029543979093432426,
      "mae_dx": 0.012194293551146984,
      "mae_dy": 0.004766619298607111,
      "pose_mae_dtheta": 0.22480343282222748,
      "pose_mae_dx": 0.10629404336214066,
      "pose_mae_dy": 0.07918839901685715,
      "pose_rmse_dtheta": 0.3750438094139099,
      "pose_rmse_dx": 0.2330184131860733,
      "pose_rmse_dy": 0.17981310188770294,
      "pose_rmse_mean": 0.2626250982284546,
      "rmse_dtheta": 0.04608858749270439,
      "rmse_dx": 0.02566850744187832,
      "rmse_dy": 0.00859792809933424,
      "rmse_mean": 0.026785006746649742,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 8438.0,
      "step": 4346,
      "turn_loss": 0.22055229544639587,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.2019606021185653,
      "grad_norm": 0.45739075541496277,
      "learning_rate": 7.189478622136474e-06,
      "loss": 0.1297,
      "mae_dtheta": 0.04073449596762657,
      "mae_dx": 0.01441376656293869,
      "mae_dy": 0.0053146290592849255,
      "pose_mae_dtheta": 0.311327189207077,
      "pose_mae_dx": 0.11180742084980011,
      "pose_mae_dy": 0.06358930468559265,
      "pose_rmse_dtheta": 0.5474020838737488,
      "pose_rmse_dx": 0.24826402962207794,
      "pose_rmse_dy": 0.13998375833034515,
      "pose_rmse_mean": 0.3118833005428314,
      "rmse_dtheta": 0.05992854759097099,
      "rmse_dx": 0.028490116819739342,
      "rmse_dy": 0.009816750884056091,
      "rmse_mean": 0.03274513781070709,
      "rotation_flip": 0.010762332007288933,
      "sparse_tokens": 17900.0,
      "step": 4347,
      "turn_loss": 0.2750208377838135,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2020070618844081,
      "grad_norm": 0.5336498618125916,
      "learning_rate": 7.1882898365233345e-06,
      "loss": 0.059,
      "mae_dtheta": 0.00855296291410923,
      "mae_dx": 0.0019092687871307135,
      "mae_dy": 0.0003974150458816439,
      "pose_mae_dtheta": 0.062428537756204605,
      "pose_mae_dx": 0.015934521332383156,
      "pose_mae_dy": 0.005287711508572102,
      "pose_rmse_dtheta": 0.2420283704996109,
      "pose_rmse_dx": 0.04177743196487427,
      "pose_rmse_dy": 0.011660794727504253,
      "pose_rmse_mean": 0.09848885983228683,
      "rmse_dtheta": 0.02950291335582733,
      "rmse_dx": 0.0060305180959403515,
      "rmse_dy": 0.0010880152694880962,
      "rmse_mean": 0.012207149527966976,
      "rotation_flip": 0.0015255530597642064,
      "sparse_tokens": 32153.0,
      "step": 4348,
      "turn_loss": 0.06383978575468063,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.2020535216502509,
      "grad_norm": 0.46120867133140564,
      "learning_rate": 7.187100897881912e-06,
      "loss": 0.0886,
      "mae_dtheta": 0.034772396087646484,
      "mae_dx": 0.016222288832068443,
      "mae_dy": 0.005068518221378326,
      "pose_mae_dtheta": 0.29234421253204346,
      "pose_mae_dx": 0.11482490599155426,
      "pose_mae_dy": 0.07240202277898788,
      "pose_rmse_dtheta": 0.4519178569316864,
      "pose_rmse_dx": 0.2156207412481308,
      "pose_rmse_dy": 0.16199633479118347,
      "pose_rmse_mean": 0.27651163935661316,
      "rmse_dtheta": 0.046264927834272385,
      "rmse_dx": 0.028211772441864014,
      "rmse_dy": 0.008747643791139126,
      "rmse_mean": 0.0277414508163929,
      "rotation_flip": 0.0,
      "sparse_tokens": 2171.0,
      "step": 4349,
      "turn_loss": 0.16609983146190643,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 34064.0,
      "epoch": 0.20209998141609367,
      "grad_norm": 0.4390520453453064,
      "learning_rate": 7.185911806295347e-06,
      "loss": 0.1101,
      "mae_dtheta": 0.036801546812057495,
      "mae_dx": 0.012508310377597809,
      "mae_dy": 0.005397592205554247,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4390520453453064,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.9993438720703,
      "model/head/act_norm_mean": 104.01815476190477,
      "model/head/act_norm_min": 57.47417449951172,
      "model/head/act_over_embed": 71.48224978568884,
      "model/head/grad_frac": 0.10196224600076675,
      "model/head/grad_norm": 0.044766731560230255,
      "model/head/grad_zero_frac": 0.00016910585691221058,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.685649181547619,
      "model/head/update_ratio": 0.0007683727890253067,
      "model/head/weight_delta": 7.770155906677246,
      "model/head/weight_delta_rel": 0.13631154596805573,
      "model/head/weight_norm": 58.26173400878906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41832435131073,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41827363787956956,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41820722818374634,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28744155989033465,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10669122636318207,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04684299975633621,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5088627653301887,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015165023505687714,
      "model/modality_embedder.encoders.pose/weight_delta": 2.5549402236938477,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08347786217927933,
      "model/modality_embedder.encoders.pose/weight_norm": 30.88884162902832,
      "model/modality_embedder/grad_frac": 0.10669122636318207,
      "model/modality_embedder/grad_norm": 0.04684299975633621,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5088627653301887,
      "model/modality_embedder/update_ratio": 0.0015165023505687714,
      "model/modality_embedder/weight_delta": 2.5549402236938477,
      "model/modality_embedder/weight_delta_rel": 0.08347786217927933,
      "model/modality_embedder/weight_norm": 30.88884162902832,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.64897155761719,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.974163832199547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.200947761535645,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.788060472998085,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1078789234161377,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04736446216702461,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017055991338565946,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.8561941385269165,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06764083355665207,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.76998519897461,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 80.25399780273438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.816468253968253,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.634110450744629,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.36689995741578,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10704394429922104,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04699786379933357,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001595549751073122,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.346815824508667,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08129553496837616,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.45559310913086,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.76290130615234,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.4661611866969,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.328742980957031,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.500584385455475,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.12174661457538605,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.053453098982572556,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017578264232724905,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.5211620330810547,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08465590327978134,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.408632278442383,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.82418060302734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.421534863945578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.094921112060547,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.844335482957558,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12381410598754883,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05436083674430847,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018297480419278145,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.152606725692749,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07356588542461395,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.70946502685547,
      "model/normalizer/grad_frac": 0.47664764523506165,
      "model/normalizer/grad_norm": 0.20927312970161438,
      "model/normalizer/grad_zero_frac": 0.00012880949361715466,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002672560280188918,
      "model/normalizer/weight_delta": 4.570230960845947,
      "model/normalizer/weight_delta_rel": 0.058861929923295975,
      "model/normalizer/weight_norm": 78.30435943603516,
      "pose_mae_dtheta": 0.28599342703819275,
      "pose_mae_dx": 0.09682643413543701,
      "pose_mae_dy": 0.0680573582649231,
      "pose_rmse_dtheta": 0.48191002011299133,
      "pose_rmse_dx": 0.20639841258525848,
      "pose_rmse_dy": 0.15116895735263824,
      "pose_rmse_mean": 0.2798258066177368,
      "rmse_dtheta": 0.05358516052365303,
      "rmse_dx": 0.02445892058312893,
      "rmse_dy": 0.010502386838197708,
      "rmse_mean": 0.02951548993587494,
      "rotation_flip": 0.013316423632204533,
      "sparse_tokens": 27445.0,
      "step": 4350,
      "turn_loss": 0.30258893966674805,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20214644118193645,
      "grad_norm": 0.4564689099788666,
      "learning_rate": 7.1847225618467975e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.006356833502650261,
      "mae_dx": 0.0012460852740332484,
      "mae_dy": 0.0010048778494819999,
      "pose_mae_dtheta": 0.04704545438289642,
      "pose_mae_dx": 0.014119467698037624,
      "pose_mae_dy": 0.01611688733100891,
      "pose_rmse_dtheta": 0.1523277461528778,
      "pose_rmse_dx": 0.045495085418224335,
      "pose_rmse_dy": 0.03800191357731819,
      "pose_rmse_mean": 0.07860825210809708,
      "rmse_dtheta": 0.016381561756134033,
      "rmse_dx": 0.005020981654524803,
      "rmse_dy": 0.0019838986918330193,
      "rmse_mean": 0.0077954805456101894,
      "rotation_flip": 0.0025239777751266956,
      "sparse_tokens": 32073.0,
      "step": 4351,
      "turn_loss": 0.04946821555495262,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.20219290094777922,
      "grad_norm": 0.5891801714897156,
      "learning_rate": 7.183533164619427e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.012227252125740051,
      "mae_dx": 0.002672394970431924,
      "mae_dy": 0.002586111193522811,
      "pose_mae_dtheta": 0.0807129517197609,
      "pose_mae_dx": 0.03307727351784706,
      "pose_mae_dy": 0.029725823551416397,
      "pose_rmse_dtheta": 0.1847172975540161,
      "pose_rmse_dx": 0.07918809354305267,
      "pose_rmse_dy": 0.06480944156646729,
      "pose_rmse_mean": 0.10957162082195282,
      "rmse_dtheta": 0.025760067626833916,
      "rmse_dx": 0.007366039324551821,
      "rmse_dy": 0.005272900220006704,
      "rmse_mean": 0.012799669057130814,
      "rotation_flip": 0.003716216189786792,
      "sparse_tokens": 32153.0,
      "step": 4352,
      "turn_loss": 0.11333777755498886,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2302.0,
      "epoch": 0.202239360713622,
      "grad_norm": 0.6276646852493286,
      "learning_rate": 7.182343614696412e-06,
      "loss": 0.133,
      "mae_dtheta": 0.03946622833609581,
      "mae_dx": 0.021691756322979927,
      "mae_dy": 0.0012166766682639718,
      "pose_mae_dtheta": 0.3484959304332733,
      "pose_mae_dx": 0.19101464748382568,
      "pose_mae_dy": 0.02531576342880726,
      "pose_rmse_dtheta": 0.6118582487106323,
      "pose_rmse_dx": 0.3639935851097107,
      "pose_rmse_dy": 0.05462297424674034,
      "pose_rmse_mean": 0.3434916138648987,
      "rmse_dtheta": 0.06099528819322586,
      "rmse_dx": 0.03530539944767952,
      "rmse_dy": 0.002053680596873164,
      "rmse_mean": 0.03278478980064392,
      "rotation_flip": 0.0,
      "sparse_tokens": 1735.0,
      "step": 4353,
      "turn_loss": 0.2976813018321991,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.20228582047946478,
      "grad_norm": 0.5744726657867432,
      "learning_rate": 7.181153912160935e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.00718638626858592,
      "mae_dx": 0.0021399897523224354,
      "mae_dy": 0.00036798196379095316,
      "pose_mae_dtheta": 0.05717653036117554,
      "pose_mae_dx": 0.019102787598967552,
      "pose_mae_dy": 0.004896458238363266,
      "pose_rmse_dtheta": 0.24152874946594238,
      "pose_rmse_dx": 0.06691626459360123,
      "pose_rmse_dy": 0.011334512382745743,
      "pose_rmse_mean": 0.10659317672252655,
      "rmse_dtheta": 0.026665817946195602,
      "rmse_dx": 0.00741939339786768,
      "rmse_dy": 0.0012632968137040734,
      "rmse_mean": 0.01178283616900444,
      "rotation_flip": 0.0021857924293726683,
      "sparse_tokens": 32121.0,
      "step": 4354,
      "turn_loss": 0.057276345789432526,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.20233228024530756,
      "grad_norm": 0.4975721538066864,
      "learning_rate": 7.179964057096195e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.04017210006713867,
      "mae_dx": 0.013698993250727654,
      "mae_dy": 0.005817166529595852,
      "pose_mae_dtheta": 0.30967187881469727,
      "pose_mae_dx": 0.1380964070558548,
      "pose_mae_dy": 0.04825398325920105,
      "pose_rmse_dtheta": 0.4955689609050751,
      "pose_rmse_dx": 0.2566252052783966,
      "pose_rmse_dy": 0.1253148317337036,
      "pose_rmse_mean": 0.2925029993057251,
      "rmse_dtheta": 0.05655553191900253,
      "rmse_dx": 0.025264589115977287,
      "rmse_dy": 0.012859744019806385,
      "rmse_mean": 0.031559959053993225,
      "rotation_flip": 0.013201320543885231,
      "sparse_tokens": 5642.0,
      "step": 4355,
      "turn_loss": 0.2979547381401062,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.20237874001115033,
      "grad_norm": 0.6241543292999268,
      "learning_rate": 7.178774049585397e-06,
      "loss": 0.0923,
      "mae_dtheta": 0.016017289832234383,
      "mae_dx": 0.0022985616233199835,
      "mae_dy": 0.004630505107343197,
      "pose_mae_dtheta": 0.10569225996732712,
      "pose_mae_dx": 0.04216133803129196,
      "pose_mae_dy": 0.056597162038087845,
      "pose_rmse_dtheta": 0.21225175261497498,
      "pose_rmse_dx": 0.09738050401210785,
      "pose_rmse_dy": 0.1485861986875534,
      "pose_rmse_mean": 0.1527394950389862,
      "rmse_dtheta": 0.028132207691669464,
      "rmse_dx": 0.005694598890841007,
      "rmse_dy": 0.009275725111365318,
      "rmse_mean": 0.014367511495947838,
      "rotation_flip": 0.005670446902513504,
      "sparse_tokens": 32057.0,
      "step": 4356,
      "turn_loss": 0.1341637372970581,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.20242519977699314,
      "grad_norm": 0.8081784248352051,
      "learning_rate": 7.177583889711763e-06,
      "loss": 0.165,
      "mae_dtheta": 0.014248378574848175,
      "mae_dx": 0.00458826357498765,
      "mae_dy": 0.005332745146006346,
      "pose_mae_dtheta": 0.10465270280838013,
      "pose_mae_dx": 0.047872599214315414,
      "pose_mae_dy": 0.04965747892856598,
      "pose_rmse_dtheta": 0.24517513811588287,
      "pose_rmse_dx": 0.10340488702058792,
      "pose_rmse_dy": 0.13285532593727112,
      "pose_rmse_mean": 0.16047845780849457,
      "rmse_dtheta": 0.030167685821652412,
      "rmse_dx": 0.010439080186188221,
      "rmse_dy": 0.012937993742525578,
      "rmse_mean": 0.01784825325012207,
      "rotation_flip": 0.005323505494743586,
      "sparse_tokens": 32169.0,
      "step": 4357,
      "turn_loss": 0.17204007506370544,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13605.0,
      "epoch": 0.2024716595428359,
      "grad_norm": 0.6208706498146057,
      "learning_rate": 7.176393577558516e-06,
      "loss": 0.1452,
      "mae_dtheta": 0.035680487751960754,
      "mae_dx": 0.010401704348623753,
      "mae_dy": 0.0060217431746423244,
      "pose_mae_dtheta": 0.3092576265335083,
      "pose_mae_dx": 0.08005548268556595,
      "pose_mae_dy": 0.08709245175123215,
      "pose_rmse_dtheta": 0.5417041778564453,
      "pose_rmse_dx": 0.1888224482536316,
      "pose_rmse_dy": 0.1899920552968979,
      "pose_rmse_mean": 0.30683958530426025,
      "rmse_dtheta": 0.054473910480737686,
      "rmse_dx": 0.022260596975684166,
      "rmse_dy": 0.010486992076039314,
      "rmse_mean": 0.02907383255660534,
      "rotation_flip": 0.01157742366194725,
      "sparse_tokens": 11458.0,
      "step": 4358,
      "turn_loss": 0.26849064230918884,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.2025181193086787,
      "grad_norm": 0.4884360730648041,
      "learning_rate": 7.1752031132089e-06,
      "loss": 0.1455,
      "mae_dtheta": 0.03183113411068916,
      "mae_dx": 0.010324360802769661,
      "mae_dy": 0.005100229289382696,
      "pose_mae_dtheta": 0.23955751955509186,
      "pose_mae_dx": 0.0975385457277298,
      "pose_mae_dy": 0.05249226838350296,
      "pose_rmse_dtheta": 0.429325670003891,
      "pose_rmse_dx": 0.2134665846824646,
      "pose_rmse_dy": 0.11516688764095306,
      "pose_rmse_mean": 0.2526530623435974,
      "rmse_dtheta": 0.0514276921749115,
      "rmse_dx": 0.022112995386123657,
      "rmse_dy": 0.011672819964587688,
      "rmse_mean": 0.02840450219810009,
      "rotation_flip": 0.00997150968760252,
      "sparse_tokens": 11687.0,
      "step": 4359,
      "turn_loss": 0.2539338171482086,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.20256457907452147,
      "grad_norm": 0.6679975986480713,
      "learning_rate": 7.174012496746161e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.013776278123259544,
      "mae_dx": 0.001942899776622653,
      "mae_dy": 0.0029721108730882406,
      "pose_mae_dtheta": 0.09715008735656738,
      "pose_mae_dx": 0.028150387108325958,
      "pose_mae_dy": 0.03838464990258217,
      "pose_rmse_dtheta": 0.22576698660850525,
      "pose_rmse_dx": 0.07516761869192123,
      "pose_rmse_dy": 0.09043494611978531,
      "pose_rmse_mean": 0.13045652210712433,
      "rmse_dtheta": 0.027478355914354324,
      "rmse_dx": 0.0058860755525529385,
      "rmse_dy": 0.0063820770010352135,
      "rmse_mean": 0.013248836621642113,
      "rotation_flip": 0.012473118491470814,
      "sparse_tokens": 32057.0,
      "step": 4360,
      "turn_loss": 0.10188367962837219,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.20261103884036424,
      "grad_norm": 0.6276006698608398,
      "learning_rate": 7.172821728253563e-06,
      "loss": 0.149,
      "mae_dtheta": 0.02514980360865593,
      "mae_dx": 0.007586719933897257,
      "mae_dy": 0.005928097292780876,
      "pose_mae_dtheta": 0.18065118789672852,
      "pose_mae_dx": 0.07068988680839539,
      "pose_mae_dy": 0.08753882348537445,
      "pose_rmse_dtheta": 0.2611023783683777,
      "pose_rmse_dx": 0.1274062842130661,
      "pose_rmse_dy": 0.15504801273345947,
      "pose_rmse_mean": 0.18118557333946228,
      "rmse_dtheta": 0.038279641419649124,
      "rmse_dx": 0.017627572640776634,
      "rmse_dy": 0.009292278438806534,
      "rmse_mean": 0.02173316478729248,
      "rotation_flip": 0.004065040498971939,
      "sparse_tokens": 5179.0,
      "step": 4361,
      "turn_loss": 0.22420111298561096,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20265749860620702,
      "grad_norm": 0.7071030139923096,
      "learning_rate": 7.171630807814374e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.008896959945559502,
      "mae_dx": 0.00132160319481045,
      "mae_dy": 0.001516177086159587,
      "pose_mae_dtheta": 0.060697510838508606,
      "pose_mae_dx": 0.016575757414102554,
      "pose_mae_dy": 0.020491350442171097,
      "pose_rmse_dtheta": 0.1764817088842392,
      "pose_rmse_dx": 0.04285842180252075,
      "pose_rmse_dy": 0.04800958186388016,
      "pose_rmse_mean": 0.08911657333374023,
      "rmse_dtheta": 0.022311290726065636,
      "rmse_dx": 0.004412792157381773,
      "rmse_dy": 0.0030293765012174845,
      "rmse_mean": 0.009917819872498512,
      "rotation_flip": 0.0019455252913758159,
      "sparse_tokens": 32073.0,
      "step": 4362,
      "turn_loss": 0.06356226652860641,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2027039583720498,
      "grad_norm": 0.41453132033348083,
      "learning_rate": 7.170439735511876e-06,
      "loss": 0.0878,
      "mae_dtheta": 0.011242948472499847,
      "mae_dx": 0.00174802599940449,
      "mae_dy": 0.0020332406274974346,
      "pose_mae_dtheta": 0.07856126874685287,
      "pose_mae_dx": 0.021755032241344452,
      "pose_mae_dy": 0.024830035865306854,
      "pose_rmse_dtheta": 0.1951257586479187,
      "pose_rmse_dx": 0.05082191154360771,
      "pose_rmse_dy": 0.05562674626708031,
      "pose_rmse_mean": 0.10052480548620224,
      "rmse_dtheta": 0.023473555222153664,
      "rmse_dx": 0.005411592312157154,
      "rmse_dy": 0.004005579277873039,
      "rmse_mean": 0.010963576845824718,
      "rotation_flip": 0.0073149739764630795,
      "sparse_tokens": 32073.0,
      "step": 4363,
      "turn_loss": 0.08675055205821991,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.20275041813789257,
      "grad_norm": 0.41720765829086304,
      "learning_rate": 7.169248511429364e-06,
      "loss": 0.0962,
      "mae_dtheta": 0.03239433467388153,
      "mae_dx": 0.013374238274991512,
      "mae_dy": 0.005224093794822693,
      "pose_mae_dtheta": 0.253478080034256,
      "pose_mae_dx": 0.10431043058633804,
      "pose_mae_dy": 0.06467490643262863,
      "pose_rmse_dtheta": 0.4437330663204193,
      "pose_rmse_dx": 0.214996799826622,
      "pose_rmse_dy": 0.16054470837116241,
      "pose_rmse_mean": 0.27309152483940125,
      "rmse_dtheta": 0.04950898513197899,
      "rmse_dx": 0.025831857696175575,
      "rmse_dy": 0.011667600832879543,
      "rmse_mean": 0.02900281548500061,
      "rotation_flip": 0.011168384924530983,
      "sparse_tokens": 19907.0,
      "step": 4364,
      "turn_loss": 0.30172544717788696,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.20279687790373538,
      "grad_norm": 0.5388885736465454,
      "learning_rate": 7.168057135650139e-06,
      "loss": 0.159,
      "mae_dtheta": 0.03207343444228172,
      "mae_dx": 0.01183498278260231,
      "mae_dy": 0.004240205977112055,
      "pose_mae_dtheta": 0.2682529389858246,
      "pose_mae_dx": 0.09083176404237747,
      "pose_mae_dy": 0.0408819280564785,
      "pose_rmse_dtheta": 0.4827599823474884,
      "pose_rmse_dx": 0.20183604955673218,
      "pose_rmse_dy": 0.09113778918981552,
      "pose_rmse_mean": 0.25857794284820557,
      "rmse_dtheta": 0.05140377953648567,
      "rmse_dx": 0.023820629343390465,
      "rmse_dy": 0.008817275986075401,
      "rmse_mean": 0.028013896197080612,
      "rotation_flip": 0.013605441898107529,
      "sparse_tokens": 10616.0,
      "step": 4365,
      "turn_loss": 0.26135435700416565,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.20284333766957816,
      "grad_norm": 0.44413861632347107,
      "learning_rate": 7.166865608257515e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.009845735505223274,
      "mae_dx": 0.0020358460023999214,
      "mae_dy": 0.001510889851488173,
      "pose_mae_dtheta": 0.07182858139276505,
      "pose_mae_dx": 0.016548365354537964,
      "pose_mae_dy": 0.01590641960501671,
      "pose_rmse_dtheta": 0.2452884018421173,
      "pose_rmse_dx": 0.038218725472688675,
      "pose_rmse_dy": 0.04222554713487625,
      "pose_rmse_mean": 0.10857756435871124,
      "rmse_dtheta": 0.028802335262298584,
      "rmse_dx": 0.006025129929184914,
      "rmse_dy": 0.0051415725611150265,
      "rmse_mean": 0.013323011808097363,
      "rotation_flip": 0.0032213530503213406,
      "sparse_tokens": 32169.0,
      "step": 4366,
      "turn_loss": 0.09675811976194382,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.20288979743542093,
      "grad_norm": 0.6084763407707214,
      "learning_rate": 7.165673929334816e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.03033480793237686,
      "mae_dx": 0.004750072956085205,
      "mae_dy": 0.00360801606439054,
      "pose_mae_dtheta": 0.1995863914489746,
      "pose_mae_dx": 0.02623705193400383,
      "pose_mae_dy": 0.03578305244445801,
      "pose_rmse_dtheta": 0.41779422760009766,
      "pose_rmse_dx": 0.059545326977968216,
      "pose_rmse_dy": 0.0872412621974945,
      "pose_rmse_mean": 0.18819360435009003,
      "rmse_dtheta": 0.051542747765779495,
      "rmse_dx": 0.011536168865859509,
      "rmse_dy": 0.009035374037921429,
      "rmse_mean": 0.024038096889853477,
      "rotation_flip": 0.0047505940310657024,
      "sparse_tokens": 7496.0,
      "step": 4367,
      "turn_loss": 0.1725837141275406,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 1658.0,
      "epoch": 0.2029362572012637,
      "grad_norm": 0.6419439911842346,
      "learning_rate": 7.164482098965378e-06,
      "loss": 0.1422,
      "mae_dtheta": 0.05536743625998497,
      "mae_dx": 0.03274676948785782,
      "mae_dy": 0.034899547696113586,
      "pose_mae_dtheta": 0.2974231541156769,
      "pose_mae_dx": 0.17657120525836945,
      "pose_mae_dy": 0.28676366806030273,
      "pose_rmse_dtheta": 0.42882105708122253,
      "pose_rmse_dx": 0.3030124604701996,
      "pose_rmse_dy": 0.4683750867843628,
      "pose_rmse_mean": 0.40006956458091736,
      "rmse_dtheta": 0.07124537229537964,
      "rmse_dx": 0.04340513050556183,
      "rmse_dy": 0.04820631444454193,
      "rmse_mean": 0.05428560823202133,
      "rotation_flip": 0.014084506779909134,
      "sparse_tokens": 1450.0,
      "step": 4368,
      "turn_loss": 0.7666357755661011,
      "turns": 5.0,
      "turns_per_sample": 5.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.20298271696710649,
      "grad_norm": 0.4255569875240326,
      "learning_rate": 7.163290117232542e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.011020620353519917,
      "mae_dx": 0.002255811356008053,
      "mae_dy": 0.003550417721271515,
      "pose_mae_dtheta": 0.07729270309209824,
      "pose_mae_dx": 0.030975503847002983,
      "pose_mae_dy": 0.03497743606567383,
      "pose_rmse_dtheta": 0.18059571087360382,
      "pose_rmse_dx": 0.07772297412157059,
      "pose_rmse_dy": 0.07734290510416031,
      "pose_rmse_mean": 0.11188720166683197,
      "rmse_dtheta": 0.021909747272729874,
      "rmse_dx": 0.006252157501876354,
      "rmse_dy": 0.008069999516010284,
      "rmse_mean": 0.012077301740646362,
      "rotation_flip": 0.0024407252203673124,
      "sparse_tokens": 32137.0,
      "step": 4369,
      "turn_loss": 0.0931302085518837,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.20302917673294926,
      "grad_norm": 0.4791865646839142,
      "learning_rate": 7.162097984219668e-06,
      "loss": 0.114,
      "mae_dtheta": 0.039376989006996155,
      "mae_dx": 0.011873127892613411,
      "mae_dy": 0.00737104332074523,
      "pose_mae_dtheta": 0.2758471667766571,
      "pose_mae_dx": 0.09675515443086624,
      "pose_mae_dy": 0.07017569243907928,
      "pose_rmse_dtheta": 0.4323079288005829,
      "pose_rmse_dx": 0.21563857793807983,
      "pose_rmse_dy": 0.1924847513437271,
      "pose_rmse_mean": 0.28014373779296875,
      "rmse_dtheta": 0.0540255568921566,
      "rmse_dx": 0.022409910336136818,
      "rmse_dy": 0.017441319301724434,
      "rmse_mean": 0.03129226341843605,
      "rotation_flip": 0.03664921596646309,
      "sparse_tokens": 9088.0,
      "step": 4370,
      "turn_loss": 0.43273109197616577,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.20307563649879204,
      "grad_norm": 0.6014564633369446,
      "learning_rate": 7.160905700010122e-06,
      "loss": 0.1335,
      "mae_dtheta": 0.027682291343808174,
      "mae_dx": 0.010002503171563148,
      "mae_dy": 0.007953228428959846,
      "pose_mae_dtheta": 0.21841543912887573,
      "pose_mae_dx": 0.0779070258140564,
      "pose_mae_dy": 0.10169538855552673,
      "pose_rmse_dtheta": 0.41501376032829285,
      "pose_rmse_dx": 0.19914469122886658,
      "pose_rmse_dy": 0.22711993753910065,
      "pose_rmse_mean": 0.28042614459991455,
      "rmse_dtheta": 0.04384182021021843,
      "rmse_dx": 0.022579390555620193,
      "rmse_dy": 0.0176157858222723,
      "rmse_mean": 0.028012333437800407,
      "rotation_flip": 0.01004016026854515,
      "sparse_tokens": 9079.0,
      "step": 4371,
      "turn_loss": 0.2212606519460678,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.20312209626463482,
      "grad_norm": 0.4886135756969452,
      "learning_rate": 7.159713264687281e-06,
      "loss": 0.1369,
      "mae_dtheta": 0.02577294409275055,
      "mae_dx": 0.014239035546779633,
      "mae_dy": 0.007913169451057911,
      "pose_mae_dtheta": 0.21927480399608612,
      "pose_mae_dx": 0.1021665409207344,
      "pose_mae_dy": 0.06328822672367096,
      "pose_rmse_dtheta": 0.33504199981689453,
      "pose_rmse_dx": 0.22220532596111298,
      "pose_rmse_dy": 0.1727045476436615,
      "pose_rmse_mean": 0.24331729114055634,
      "rmse_dtheta": 0.03962887078523636,
      "rmse_dx": 0.026248646900057793,
      "rmse_dy": 0.016418354585766792,
      "rmse_mean": 0.02743195742368698,
      "rotation_flip": 0.011185682378709316,
      "sparse_tokens": 7345.0,
      "step": 4372,
      "turn_loss": 0.3676096498966217,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.2031685560304776,
      "grad_norm": 0.6664067506790161,
      "learning_rate": 7.158520678334533e-06,
      "loss": 0.1957,
      "mae_dtheta": 0.030435260385274887,
      "mae_dx": 0.013019984588027,
      "mae_dy": 0.005498906131833792,
      "pose_mae_dtheta": 0.26130324602127075,
      "pose_mae_dx": 0.10102614760398865,
      "pose_mae_dy": 0.08149847388267517,
      "pose_rmse_dtheta": 0.4361497759819031,
      "pose_rmse_dx": 0.23808369040489197,
      "pose_rmse_dy": 0.1853148192167282,
      "pose_rmse_mean": 0.28651610016822815,
      "rmse_dtheta": 0.04648764431476593,
      "rmse_dx": 0.02720891684293747,
      "rmse_dy": 0.009632030501961708,
      "rmse_mean": 0.027776196599006653,
      "rotation_flip": 0.017241379246115685,
      "sparse_tokens": 10485.0,
      "step": 4373,
      "turn_loss": 0.27390387654304504,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.2032150157963204,
      "grad_norm": 0.5895082354545593,
      "learning_rate": 7.1573279410352735e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.029364563524723053,
      "mae_dx": 0.004220223519951105,
      "mae_dy": 0.00415304908528924,
      "pose_mae_dtheta": 0.2860150635242462,
      "pose_mae_dx": 0.021257998421788216,
      "pose_mae_dy": 0.04511215537786484,
      "pose_rmse_dtheta": 0.4453045725822449,
      "pose_rmse_dx": 0.04303719103336334,
      "pose_rmse_dy": 0.13136078417301178,
      "pose_rmse_mean": 0.20656751096248627,
      "rmse_dtheta": 0.044354647397994995,
      "rmse_dx": 0.010820740833878517,
      "rmse_dy": 0.008033819496631622,
      "rmse_mean": 0.021069735288619995,
      "rotation_flip": 0.01923076994717121,
      "sparse_tokens": 2561.0,
      "step": 4374,
      "turn_loss": 0.18296238780021667,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.20326147556216317,
      "grad_norm": 0.6582276821136475,
      "learning_rate": 7.1561350528729145e-06,
      "loss": 0.1666,
      "mae_dtheta": 0.01085679791867733,
      "mae_dx": 0.002007450209930539,
      "mae_dy": 0.001786243636161089,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.658227801322937,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.43504333496094,
      "model/head/act_norm_mean": 117.13942155934343,
      "model/head/act_norm_min": 61.42984390258789,
      "model/head/act_over_embed": 80.49930717212386,
      "model/head/grad_frac": 0.1019757091999054,
      "model/head/grad_norm": 0.06712324917316437,
      "model/head/grad_zero_frac": 0.00021955206466373056,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6995639993686869,
      "model/head/update_ratio": 0.001151993521489203,
      "model/head/weight_delta": 7.789218425750732,
      "model/head/weight_delta_rel": 0.13664595782756805,
      "model/head/weight_norm": 58.26703643798828,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41840124130249023,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41832777630587864,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4182477593421936,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2874787643237462,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07363639026880264,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04846951737999916,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.519986687219731,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015691487351432443,
      "model/modality_embedder.encoders.pose/weight_delta": 2.5551068782806396,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08348330855369568,
      "model/modality_embedder.encoders.pose/weight_norm": 30.889053344726562,
      "model/modality_embedder/grad_frac": 0.07363639026880264,
      "model/modality_embedder/grad_norm": 0.04846951737999916,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.519986687219731,
      "model/modality_embedder/update_ratio": 0.0015691487351432443,
      "model/modality_embedder/weight_delta": 2.5551068782806396,
      "model/modality_embedder/weight_delta_rel": 0.08348330855369568,
      "model/modality_embedder/weight_norm": 30.889053344726562,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.07255554199219,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.24797077922078,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.11740779876709,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.663432532559604,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10881750285625458,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0716267079114914,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0025791192892938852,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.8632320165634155,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06789729744195938,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.771770477294922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.79685974121094,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.265903078403078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.21584415435791,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.362965138590013,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10732907056808472,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0706469789147377,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0023981884587556124,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.3562281131744385,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08162157982587814,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.458477020263672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.59942626953125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.14552769761103,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.017791748046875,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.654660774232653,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11875839531421661,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07817007601261139,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002570429118350148,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.5308315753936768,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08498058468103409,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.411293029785156,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.23644256591797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.931835718294053,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.24446964263916,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.8822283697252,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10489502549171448,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0690448209643364,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0023238847497850657,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.1600847244262695,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07382144778966904,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.710948944091797,
      "model/normalizer/grad_frac": 0.41282224655151367,
      "model/normalizer/grad_norm": 0.27173107862472534,
      "model/normalizer/grad_zero_frac": 0.00014535382797475904,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003470054594799876,
      "model/normalizer/weight_delta": 4.587606430053711,
      "model/normalizer/weight_delta_rel": 0.05908571556210518,
      "model/normalizer/weight_norm": 78.30743408203125,
      "pose_mae_dtheta": 0.07768689095973969,
      "pose_mae_dx": 0.022742172703146935,
      "pose_mae_dy": 0.021423229947686195,
      "pose_rmse_dtheta": 0.23568101227283478,
      "pose_rmse_dx": 0.06999348104000092,
      "pose_rmse_dy": 0.06655506789684296,
      "pose_rmse_mean": 0.12407653033733368,
      "rmse_dtheta": 0.027507519349455833,
      "rmse_dx": 0.0063659027218818665,
      "rmse_dy": 0.005033623892813921,
      "rmse_mean": 0.01296901609748602,
      "rotation_flip": 0.005076142027974129,
      "sparse_tokens": 32105.0,
      "step": 4375,
      "turn_loss": 0.07222579419612885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29754.0,
      "epoch": 0.20330793532800595,
      "grad_norm": 0.49340298771858215,
      "learning_rate": 7.154942013930874e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.03239142522215843,
      "mae_dx": 0.006604333873838186,
      "mae_dy": 0.004460550844669342,
      "pose_mae_dtheta": 0.26169759035110474,
      "pose_mae_dx": 0.06261633336544037,
      "pose_mae_dy": 0.0416775681078434,
      "pose_rmse_dtheta": 0.48488283157348633,
      "pose_rmse_dx": 0.17634621262550354,
      "pose_rmse_dy": 0.10358788818120956,
      "pose_rmse_mean": 0.2549389600753784,
      "rmse_dtheta": 0.05109613388776779,
      "rmse_dx": 0.017001040279865265,
      "rmse_dy": 0.010332387872040272,
      "rmse_mean": 0.026143189519643784,
      "rotation_flip": 0.011013215407729149,
      "sparse_tokens": 24298.0,
      "step": 4376,
      "turn_loss": 0.2387891411781311,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.20335439509384873,
      "grad_norm": 0.5544536113739014,
      "learning_rate": 7.153748824292581e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.011902892030775547,
      "mae_dx": 0.0026015485636889935,
      "mae_dy": 0.0026208171620965004,
      "pose_mae_dtheta": 0.08357427269220352,
      "pose_mae_dx": 0.025656167417764664,
      "pose_mae_dy": 0.025883400812745094,
      "pose_rmse_dtheta": 0.22459149360656738,
      "pose_rmse_dx": 0.07020385563373566,
      "pose_rmse_dy": 0.06823191046714783,
      "pose_rmse_mean": 0.12100908160209656,
      "rmse_dtheta": 0.02727336622774601,
      "rmse_dx": 0.0075845494866371155,
      "rmse_dy": 0.007431020028889179,
      "rmse_mean": 0.014096311293542385,
      "rotation_flip": 0.004577611107379198,
      "sparse_tokens": 32169.0,
      "step": 4377,
      "turn_loss": 0.10480472445487976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.2034008548596915,
      "grad_norm": 0.3877679407596588,
      "learning_rate": 7.1525554840414765e-06,
      "loss": 0.0991,
      "mae_dtheta": 0.012441745027899742,
      "mae_dx": 0.0018408678006380796,
      "mae_dy": 0.0029386491514742374,
      "pose_mae_dtheta": 0.08504915237426758,
      "pose_mae_dx": 0.030745964497327805,
      "pose_mae_dy": 0.04007713496685028,
      "pose_rmse_dtheta": 0.18198920786380768,
      "pose_rmse_dx": 0.09046459943056107,
      "pose_rmse_dy": 0.09618667513132095,
      "pose_rmse_mean": 0.12288016080856323,
      "rmse_dtheta": 0.023845167830586433,
      "rmse_dx": 0.006069373805075884,
      "rmse_dy": 0.006325422320514917,
      "rmse_mean": 0.012079987674951553,
      "rotation_flip": 0.00524616613984108,
      "sparse_tokens": 32025.0,
      "step": 4378,
      "turn_loss": 0.0860673263669014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.20344731462553428,
      "grad_norm": 0.5354322195053101,
      "learning_rate": 7.151361993261013e-06,
      "loss": 0.1472,
      "mae_dtheta": 0.037838164716959,
      "mae_dx": 0.010447662323713303,
      "mae_dy": 0.008475867100059986,
      "pose_mae_dtheta": 0.30421292781829834,
      "pose_mae_dx": 0.08100543171167374,
      "pose_mae_dy": 0.08262113481760025,
      "pose_rmse_dtheta": 0.5306846499443054,
      "pose_rmse_dx": 0.19923004508018494,
      "pose_rmse_dy": 0.19749772548675537,
      "pose_rmse_mean": 0.3091374635696411,
      "rmse_dtheta": 0.05731458589434624,
      "rmse_dx": 0.022345464676618576,
      "rmse_dy": 0.01869203709065914,
      "rmse_mean": 0.032784029841423035,
      "rotation_flip": 0.0160570926964283,
      "sparse_tokens": 18251.0,
      "step": 4379,
      "turn_loss": 0.3429524898529053,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.20349377439137706,
      "grad_norm": 0.6568217277526855,
      "learning_rate": 7.15016835203465e-06,
      "loss": 0.1382,
      "mae_dtheta": 0.026930371299386024,
      "mae_dx": 0.009086509235203266,
      "mae_dy": 0.005214235279709101,
      "pose_mae_dtheta": 0.18596816062927246,
      "pose_mae_dx": 0.08197828382253647,
      "pose_mae_dy": 0.07494152337312698,
      "pose_rmse_dtheta": 0.33490848541259766,
      "pose_rmse_dx": 0.21387392282485962,
      "pose_rmse_dy": 0.17226576805114746,
      "pose_rmse_mean": 0.2403493970632553,
      "rmse_dtheta": 0.04533589258790016,
      "rmse_dx": 0.021443912759423256,
      "rmse_dy": 0.009974154643714428,
      "rmse_mean": 0.02558465301990509,
      "rotation_flip": 0.017391303554177284,
      "sparse_tokens": 7913.0,
      "step": 4380,
      "turn_loss": 0.29982122778892517,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20354023415721983,
      "grad_norm": 0.6314713954925537,
      "learning_rate": 7.148974560445859e-06,
      "loss": 0.1435,
      "mae_dtheta": 0.014171791262924671,
      "mae_dx": 0.0035974355414509773,
      "mae_dy": 0.004014665260910988,
      "pose_mae_dtheta": 0.10482028871774673,
      "pose_mae_dx": 0.03537146747112274,
      "pose_mae_dy": 0.040667109191417694,
      "pose_rmse_dtheta": 0.2635508179664612,
      "pose_rmse_dx": 0.09075291454792023,
      "pose_rmse_dy": 0.11317367851734161,
      "pose_rmse_mean": 0.15582579374313354,
      "rmse_dtheta": 0.029952585697174072,
      "rmse_dx": 0.010332785546779633,
      "rmse_dy": 0.011846445500850677,
      "rmse_mean": 0.017377272248268127,
      "rotation_flip": 0.011045364663004875,
      "sparse_tokens": 32089.0,
      "step": 4381,
      "turn_loss": 0.15182681381702423,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30400.0,
      "epoch": 0.20358669392306264,
      "grad_norm": 0.6046118140220642,
      "learning_rate": 7.147780618578124e-06,
      "loss": 0.1838,
      "mae_dtheta": 0.03354840725660324,
      "mae_dx": 0.012194376438856125,
      "mae_dy": 0.0065805972553789616,
      "pose_mae_dtheta": 0.2706725299358368,
      "pose_mae_dx": 0.09271018207073212,
      "pose_mae_dy": 0.08428675681352615,
      "pose_rmse_dtheta": 0.47011977434158325,
      "pose_rmse_dx": 0.21533285081386566,
      "pose_rmse_dy": 0.2032938301563263,
      "pose_rmse_mean": 0.2962488532066345,
      "rmse_dtheta": 0.05173850804567337,
      "rmse_dx": 0.02589328959584236,
      "rmse_dy": 0.014160417020320892,
      "rmse_mean": 0.03059740737080574,
      "rotation_flip": 0.01647564396262169,
      "sparse_tokens": 24475.0,
      "step": 4382,
      "turn_loss": 0.3024682402610779,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.20363315368890542,
      "grad_norm": 0.7425134778022766,
      "learning_rate": 7.146586526514938e-06,
      "loss": 0.2139,
      "mae_dtheta": 0.04555026814341545,
      "mae_dx": 0.018075160682201385,
      "mae_dy": 0.005602196790277958,
      "pose_mae_dtheta": 0.3630526661872864,
      "pose_mae_dx": 0.16774825751781464,
      "pose_mae_dy": 0.06822226941585541,
      "pose_rmse_dtheta": 0.6040219664573669,
      "pose_rmse_dx": 0.333877831697464,
      "pose_rmse_dy": 0.13513746857643127,
      "pose_rmse_mean": 0.3576790988445282,
      "rmse_dtheta": 0.06466827541589737,
      "rmse_dx": 0.03258996829390526,
      "rmse_dy": 0.010098046623170376,
      "rmse_mean": 0.035785429179668427,
      "rotation_flip": 0.012861736118793488,
      "sparse_tokens": 5137.0,
      "step": 4383,
      "turn_loss": 0.34674084186553955,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.2036796134547482,
      "grad_norm": 0.5383558869361877,
      "learning_rate": 7.145392284339804e-06,
      "loss": 0.1466,
      "mae_dtheta": 0.03481937572360039,
      "mae_dx": 0.01245186384767294,
      "mae_dy": 0.006329299882054329,
      "pose_mae_dtheta": 0.3065916895866394,
      "pose_mae_dx": 0.09221623837947845,
      "pose_mae_dy": 0.0630200207233429,
      "pose_rmse_dtheta": 0.530869722366333,
      "pose_rmse_dx": 0.20251035690307617,
      "pose_rmse_dy": 0.13762955367565155,
      "pose_rmse_mean": 0.290336549282074,
      "rmse_dtheta": 0.0529882088303566,
      "rmse_dx": 0.023887185379862785,
      "rmse_dy": 0.010995733551681042,
      "rmse_mean": 0.029290376231074333,
      "rotation_flip": 0.00193050189409405,
      "sparse_tokens": 9713.0,
      "step": 4384,
      "turn_loss": 0.23117521405220032,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20372607322059097,
      "grad_norm": 0.4496467113494873,
      "learning_rate": 7.1441978921362365e-06,
      "loss": 0.1107,
      "mae_dtheta": 0.008207762613892555,
      "mae_dx": 0.0009373887442052364,
      "mae_dy": 0.0010255492525175214,
      "pose_mae_dtheta": 0.05098951235413551,
      "pose_mae_dx": 0.013024727813899517,
      "pose_mae_dy": 0.016677802428603172,
      "pose_rmse_dtheta": 0.15577518939971924,
      "pose_rmse_dx": 0.032357506453990936,
      "pose_rmse_dy": 0.04370196536183357,
      "pose_rmse_mean": 0.07727822661399841,
      "rmse_dtheta": 0.022826846688985825,
      "rmse_dx": 0.0028979377821087837,
      "rmse_dy": 0.0022555161267518997,
      "rmse_mean": 0.009326767176389694,
      "rotation_flip": 0.0010362694738432765,
      "sparse_tokens": 32089.0,
      "step": 4385,
      "turn_loss": 0.054828155785799026,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20377253298643375,
      "grad_norm": 0.38879451155662537,
      "learning_rate": 7.143003349987759e-06,
      "loss": 0.0892,
      "mae_dtheta": 0.007713016588240862,
      "mae_dx": 0.0020398690830916166,
      "mae_dy": 0.0019553378224372864,
      "pose_mae_dtheta": 0.056775711476802826,
      "pose_mae_dx": 0.018531817942857742,
      "pose_mae_dy": 0.020017150789499283,
      "pose_rmse_dtheta": 0.14965972304344177,
      "pose_rmse_dx": 0.04798247665166855,
      "pose_rmse_dy": 0.05358332023024559,
      "pose_rmse_mean": 0.08374184370040894,
      "rmse_dtheta": 0.020676255226135254,
      "rmse_dx": 0.005864746868610382,
      "rmse_dy": 0.005200177431106567,
      "rmse_mean": 0.010580393485724926,
      "rotation_flip": 0.00482800230383873,
      "sparse_tokens": 32089.0,
      "step": 4386,
      "turn_loss": 0.0769280344247818,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.20381899275227652,
      "grad_norm": 0.6150103807449341,
      "learning_rate": 7.1418086579779075e-06,
      "loss": 0.1964,
      "mae_dtheta": 0.03436445817351341,
      "mae_dx": 0.016777167096734047,
      "mae_dy": 0.006079257931560278,
      "pose_mae_dtheta": 0.26189276576042175,
      "pose_mae_dx": 0.13253973424434662,
      "pose_mae_dy": 0.08116740733385086,
      "pose_rmse_dtheta": 0.42666998505592346,
      "pose_rmse_dx": 0.2830396294593811,
      "pose_rmse_dy": 0.17078380286693573,
      "pose_rmse_mean": 0.29349783062934875,
      "rmse_dtheta": 0.04939406365156174,
      "rmse_dx": 0.030582452192902565,
      "rmse_dy": 0.01093142107129097,
      "rmse_mean": 0.03030264377593994,
      "rotation_flip": 0.015471166931092739,
      "sparse_tokens": 25984.0,
      "step": 4387,
      "turn_loss": 0.31718772649765015,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2038654525181193,
      "grad_norm": 0.3621896505355835,
      "learning_rate": 7.140613816190225e-06,
      "loss": 0.0848,
      "mae_dtheta": 0.010802757926285267,
      "mae_dx": 0.001967900898307562,
      "mae_dy": 0.0025570241268724203,
      "pose_mae_dtheta": 0.0801423043012619,
      "pose_mae_dx": 0.026444658637046814,
      "pose_mae_dy": 0.029978858307003975,
      "pose_rmse_dtheta": 0.19269782304763794,
      "pose_rmse_dx": 0.08231284469366074,
      "pose_rmse_dy": 0.06580626964569092,
      "pose_rmse_mean": 0.11360564827919006,
      "rmse_dtheta": 0.023980174213647842,
      "rmse_dx": 0.006454515270888805,
      "rmse_dy": 0.0065311649814248085,
      "rmse_mean": 0.012321951799094677,
      "rotation_flip": 0.0055698370561003685,
      "sparse_tokens": 32057.0,
      "step": 4388,
      "turn_loss": 0.08832131326198578,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 63871.0,
      "epoch": 0.20391191228396208,
      "grad_norm": 0.3635827302932739,
      "learning_rate": 7.1394188247082715e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.010611063800752163,
      "mae_dx": 0.001861905213445425,
      "mae_dy": 0.0022390075027942657,
      "pose_mae_dtheta": 0.07196516543626785,
      "pose_mae_dx": 0.022052088752388954,
      "pose_mae_dy": 0.026645122095942497,
      "pose_rmse_dtheta": 0.178527370095253,
      "pose_rmse_dx": 0.060544971376657486,
      "pose_rmse_dy": 0.07776821404695511,
      "pose_rmse_mean": 0.10561352223157883,
      "rmse_dtheta": 0.023525426164269447,
      "rmse_dx": 0.005649874452501535,
      "rmse_dy": 0.006410573143512011,
      "rmse_mean": 0.011861957609653473,
      "rotation_flip": 0.007877461612224579,
      "sparse_tokens": 32071.0,
      "step": 4389,
      "turn_loss": 0.097499780356884,
      "turns": 196.0,
      "turns_per_sample": 196.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.20395837204980488,
      "grad_norm": 0.40314632654190063,
      "learning_rate": 7.13822368361561e-06,
      "loss": 0.0901,
      "mae_dtheta": 0.004409514367580414,
      "mae_dx": 0.0026047672145068645,
      "mae_dy": 0.000436645932495594,
      "pose_mae_dtheta": 0.03361241891980171,
      "pose_mae_dx": 0.021275782957673073,
      "pose_mae_dy": 0.007075445726513863,
      "pose_rmse_dtheta": 0.15101976692676544,
      "pose_rmse_dx": 0.09719043970108032,
      "pose_rmse_dy": 0.01629732735455036,
      "pose_rmse_mean": 0.08816917985677719,
      "rmse_dtheta": 0.017647411674261093,
      "rmse_dx": 0.010326818563044071,
      "rmse_dy": 0.0012101663742214441,
      "rmse_mean": 0.00972813181579113,
      "rotation_flip": 0.003565062303096056,
      "sparse_tokens": 32057.0,
      "step": 4390,
      "turn_loss": 0.039074718952178955,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.20400483181564766,
      "grad_norm": 0.603671133518219,
      "learning_rate": 7.13702839299582e-06,
      "loss": 0.1588,
      "mae_dtheta": 0.034901391714811325,
      "mae_dx": 0.009038214571774006,
      "mae_dy": 0.00595557177439332,
      "pose_mae_dtheta": 0.30095577239990234,
      "pose_mae_dx": 0.07086269557476044,
      "pose_mae_dy": 0.08113881200551987,
      "pose_rmse_dtheta": 0.5262364745140076,
      "pose_rmse_dx": 0.16065526008605957,
      "pose_rmse_dy": 0.16845135390758514,
      "pose_rmse_mean": 0.2851143777370453,
      "rmse_dtheta": 0.052545029670000076,
      "rmse_dx": 0.019979014992713928,
      "rmse_dy": 0.010261524468660355,
      "rmse_mean": 0.027595188468694687,
      "rotation_flip": 0.016320474445819855,
      "sparse_tokens": 13219.0,
      "step": 4391,
      "turn_loss": 0.2652174234390259,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.20405129158149043,
      "grad_norm": 0.4142026901245117,
      "learning_rate": 7.135832952932488e-06,
      "loss": 0.1052,
      "mae_dtheta": 0.011874775402247906,
      "mae_dx": 0.0020430919248610735,
      "mae_dy": 0.0032189993653446436,
      "pose_mae_dtheta": 0.07683352380990982,
      "pose_mae_dx": 0.031241154298186302,
      "pose_mae_dy": 0.03515041619539261,
      "pose_rmse_dtheta": 0.15354491770267487,
      "pose_rmse_dx": 0.08371831476688385,
      "pose_rmse_dy": 0.07311660051345825,
      "pose_rmse_mean": 0.10345994681119919,
      "rmse_dtheta": 0.021541057154536247,
      "rmse_dx": 0.006554216146469116,
      "rmse_dy": 0.006568940822035074,
      "rmse_mean": 0.011554738506674767,
      "rotation_flip": 0.0043779644183814526,
      "sparse_tokens": 32057.0,
      "step": 4392,
      "turn_loss": 0.09909296780824661,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2040977513473332,
      "grad_norm": 0.512124240398407,
      "learning_rate": 7.1346373635092095e-06,
      "loss": 0.1004,
      "mae_dtheta": 0.007813787087798119,
      "mae_dx": 0.003129691118374467,
      "mae_dy": 0.0015533227706328034,
      "pose_mae_dtheta": 0.0543631874024868,
      "pose_mae_dx": 0.035395700484514236,
      "pose_mae_dy": 0.02001086249947548,
      "pose_rmse_dtheta": 0.1529674530029297,
      "pose_rmse_dx": 0.10916757583618164,
      "pose_rmse_dy": 0.047069888561964035,
      "pose_rmse_mean": 0.10306830704212189,
      "rmse_dtheta": 0.020860159769654274,
      "rmse_dx": 0.010663739405572414,
      "rmse_dy": 0.0036756484769284725,
      "rmse_mean": 0.011733181774616241,
      "rotation_flip": 0.002020202111452818,
      "sparse_tokens": 32105.0,
      "step": 4393,
      "turn_loss": 0.09658316522836685,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.204144211113176,
      "grad_norm": 0.3679676353931427,
      "learning_rate": 7.133441624809596e-06,
      "loss": 0.0845,
      "mae_dtheta": 0.009851493872702122,
      "mae_dx": 0.002387034008279443,
      "mae_dy": 0.0016264194855466485,
      "pose_mae_dtheta": 0.06740289181470871,
      "pose_mae_dx": 0.0241786390542984,
      "pose_mae_dy": 0.024670252576470375,
      "pose_rmse_dtheta": 0.16062673926353455,
      "pose_rmse_dx": 0.0604461207985878,
      "pose_rmse_dy": 0.07849867641925812,
      "pose_rmse_mean": 0.09985717386007309,
      "rmse_dtheta": 0.02240118943154812,
      "rmse_dx": 0.007374241016805172,
      "rmse_dy": 0.0034129007253795862,
      "rmse_mean": 0.01106277760118246,
      "rotation_flip": 0.0054298643954098225,
      "sparse_tokens": 32153.0,
      "step": 4394,
      "turn_loss": 0.10537657141685486,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20419067087901877,
      "grad_norm": 0.5310279726982117,
      "learning_rate": 7.132245736917263e-06,
      "loss": 0.1226,
      "mae_dtheta": 0.011427264660596848,
      "mae_dx": 0.0022335953544825315,
      "mae_dy": 0.002461391733959317,
      "pose_mae_dtheta": 0.08366192877292633,
      "pose_mae_dx": 0.022654226049780846,
      "pose_mae_dy": 0.02501685917377472,
      "pose_rmse_dtheta": 0.25539806485176086,
      "pose_rmse_dx": 0.0683954730629921,
      "pose_rmse_dy": 0.05678984522819519,
      "pose_rmse_mean": 0.12686112523078918,
      "rmse_dtheta": 0.02787351980805397,
      "rmse_dx": 0.0073682586662471294,
      "rmse_dy": 0.006385799031704664,
      "rmse_mean": 0.013875859789550304,
      "rotation_flip": 0.005735354498028755,
      "sparse_tokens": 32089.0,
      "step": 4395,
      "turn_loss": 0.09768637269735336,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.20423713064486154,
      "grad_norm": 0.5268107056617737,
      "learning_rate": 7.131049699915842e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.03031568042933941,
      "mae_dx": 0.010206387378275394,
      "mae_dy": 0.005367758683860302,
      "pose_mae_dtheta": 0.21901895105838776,
      "pose_mae_dx": 0.09623649716377258,
      "pose_mae_dy": 0.048901814967393875,
      "pose_rmse_dtheta": 0.4170060455799103,
      "pose_rmse_dx": 0.21601325273513794,
      "pose_rmse_dy": 0.09573842585086823,
      "pose_rmse_mean": 0.24291925132274628,
      "rmse_dtheta": 0.0473816879093647,
      "rmse_dx": 0.021158691495656967,
      "rmse_dy": 0.010668485425412655,
      "rmse_mean": 0.026402955874800682,
      "rotation_flip": 0.014184396713972092,
      "sparse_tokens": 11599.0,
      "step": 4396,
      "turn_loss": 0.24701422452926636,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.20428359041070432,
      "grad_norm": 0.5535916686058044,
      "learning_rate": 7.129853513888972e-06,
      "loss": 0.1718,
      "mae_dtheta": 0.012091181240975857,
      "mae_dx": 0.0018043529707938433,
      "mae_dy": 0.002062592888250947,
      "pose_mae_dtheta": 0.07992785423994064,
      "pose_mae_dx": 0.021363452076911926,
      "pose_mae_dy": 0.02629042975604534,
      "pose_rmse_dtheta": 0.21536211669445038,
      "pose_rmse_dx": 0.05110955610871315,
      "pose_rmse_dy": 0.06576947122812271,
      "pose_rmse_mean": 0.11074705421924591,
      "rmse_dtheta": 0.02682405710220337,
      "rmse_dx": 0.00536466296762228,
      "rmse_dy": 0.0043906886130571365,
      "rmse_mean": 0.012193135917186737,
      "rotation_flip": 0.0048872181214392185,
      "sparse_tokens": 32105.0,
      "step": 4397,
      "turn_loss": 0.09471084177494049,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.20433005017654712,
      "grad_norm": 0.6960128545761108,
      "learning_rate": 7.128657178920302e-06,
      "loss": 0.1542,
      "mae_dtheta": 0.027302103117108345,
      "mae_dx": 0.007150947116315365,
      "mae_dy": 0.0016843638150021434,
      "pose_mae_dtheta": 0.22804813086986542,
      "pose_mae_dx": 0.05914802476763725,
      "pose_mae_dy": 0.028727632015943527,
      "pose_rmse_dtheta": 0.5192001461982727,
      "pose_rmse_dx": 0.2139621526002884,
      "pose_rmse_dy": 0.10934039205312729,
      "pose_rmse_mean": 0.28083422780036926,
      "rmse_dtheta": 0.05324012413620949,
      "rmse_dx": 0.02121998928487301,
      "rmse_dy": 0.005085780285298824,
      "rmse_mean": 0.02651529759168625,
      "rotation_flip": 0.009389671497046947,
      "sparse_tokens": 5607.0,
      "step": 4398,
      "turn_loss": 0.1538974642753601,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2043765099423899,
      "grad_norm": 0.5736493468284607,
      "learning_rate": 7.127460695093493e-06,
      "loss": 0.1298,
      "mae_dtheta": 0.010530288331210613,
      "mae_dx": 0.0017649783985689282,
      "mae_dy": 0.002436909591779113,
      "pose_mae_dtheta": 0.07176172733306885,
      "pose_mae_dx": 0.02214016020298004,
      "pose_mae_dy": 0.02935061603784561,
      "pose_rmse_dtheta": 0.15719828009605408,
      "pose_rmse_dx": 0.06674706190824509,
      "pose_rmse_dy": 0.0726529061794281,
      "pose_rmse_mean": 0.09886609017848969,
      "rmse_dtheta": 0.020817039534449577,
      "rmse_dx": 0.005879629869014025,
      "rmse_dy": 0.005568882450461388,
      "rmse_mean": 0.010755184106528759,
      "rotation_flip": 0.0046747177839279175,
      "sparse_tokens": 32073.0,
      "step": 4399,
      "turn_loss": 0.07983799278736115,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64393.0,
      "epoch": 0.20442296970823268,
      "grad_norm": 0.5785254836082458,
      "learning_rate": 7.126264062492216e-06,
      "loss": 0.0854,
      "mae_dtheta": 0.010127927176654339,
      "mae_dx": 0.0016144502442330122,
      "mae_dy": 0.0016368069918826222,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5785254240036011,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.1018829345703,
      "model/head/act_norm_mean": 113.15746330492425,
      "model/head/act_norm_min": 61.71847915649414,
      "model/head/act_over_embed": 77.76286818000648,
      "model/head/grad_frac": 0.08508438616991043,
      "model/head/grad_norm": 0.04922347888350487,
      "model/head/grad_zero_frac": 0.00017703764024190605,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6888908617424242,
      "model/head/update_ratio": 0.0008447192376479506,
      "model/head/weight_delta": 7.811995029449463,
      "model/head/weight_delta_rel": 0.13704553246498108,
      "model/head/weight_norm": 58.27199935913086,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4186818301677704,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41861841667211797,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41856855154037476,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2876784951044438,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06657541543245316,
      "model/modality_embedder.encoders.pose/grad_norm": 0.038515571504831314,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5071863785885168,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012468441855162382,
      "model/modality_embedder.encoders.pose/weight_delta": 2.560544729232788,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08366097509860992,
      "model/modality_embedder.encoders.pose/weight_norm": 30.890443801879883,
      "model/modality_embedder/grad_frac": 0.06657541543245316,
      "model/modality_embedder/grad_norm": 0.038515571504831314,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5071863785885168,
      "model/modality_embedder/update_ratio": 0.0012468441855162382,
      "model/modality_embedder/weight_delta": 2.560544729232788,
      "model/modality_embedder/weight_delta_rel": 0.08366097509860992,
      "model/modality_embedder/weight_norm": 30.890443801879883,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.46797943115234,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.77448843594677,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.09354019165039,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.338051033450167,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0653463825583458,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03780454397201538,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 7.565364649053663e-05,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013611369067803025,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.8710850477218628,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06818346679210663,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.774240493774414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.86311340332031,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.674365179573513,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.263307571411133,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.956454756449272,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06843554973602295,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.039591703563928604,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013438466703519225,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.3661491870880127,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08196526020765305,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.46147346496582,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.47977447509766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.45696799342633,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.275025367736816,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.18147609911941,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0683499425649643,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03954217955470085,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013001143233850598,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.541919231414795,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08535289019346237,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.414386749267578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.0950698852539,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.27887506012506,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.15654182434082,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.433507692317473,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07212528586387634,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.041726309806108475,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001404263311997056,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.169649600982666,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07414832711219788,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.714021682739258,
      "model/normalizer/grad_frac": 0.22772952914237976,
      "model/normalizer/grad_norm": 0.1317473202943802,
      "model/normalizer/grad_zero_frac": 0.0001477173063904047,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016823610058054328,
      "model/normalizer/weight_delta": 4.6072187423706055,
      "model/normalizer/weight_delta_rel": 0.05933830887079239,
      "model/normalizer/weight_norm": 78.31096649169922,
      "pose_mae_dtheta": 0.0693228617310524,
      "pose_mae_dx": 0.01876414567232132,
      "pose_mae_dy": 0.026046857237815857,
      "pose_rmse_dtheta": 0.16092826426029205,
      "pose_rmse_dx": 0.0614016018807888,
      "pose_rmse_dy": 0.07489661872386932,
      "pose_rmse_mean": 0.09907549619674683,
      "rmse_dtheta": 0.020879125222563744,
      "rmse_dx": 0.006594564765691757,
      "rmse_dy": 0.004084041807800531,
      "rmse_mean": 0.010519243776798248,
      "rotation_flip": 0.009659091010689735,
      "sparse_tokens": 31993.0,
      "step": 4400,
      "turn_loss": 0.06503300368785858,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.20442296970823268,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31943967938423157,
      "eval_objectnav_nopose_mae_dtheta": 0.04102570563554764,
      "eval_objectnav_nopose_mae_dx": 0.013305059634149075,
      "eval_objectnav_nopose_mae_dy": 0.005236650817096233,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3336365222930908,
      "eval_objectnav_nopose_pose_mae_dx": 0.1064949631690979,
      "eval_objectnav_nopose_pose_mae_dy": 0.05890965089201927,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5584839582443237,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2346128523349762,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13958999514579773,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3108956217765808,
      "eval_objectnav_nopose_rmse_dtheta": 0.05900822952389717,
      "eval_objectnav_nopose_rmse_dx": 0.026217589154839516,
      "eval_objectnav_nopose_rmse_dy": 0.011027045547962189,
      "eval_objectnav_nopose_rmse_mean": 0.03208428993821144,
      "eval_objectnav_nopose_rotation_flip": 0.015935329720377922,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31943967938423157,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 4400
    },
    {
      "epoch": 0.20442296970823268,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28891217708587646,
      "eval_objectnav_pose_mae_dtheta": 0.03656933456659317,
      "eval_objectnav_pose_mae_dx": 0.011667207814753056,
      "eval_objectnav_pose_mae_dy": 0.004870851989835501,
      "eval_objectnav_pose_pose_mae_dtheta": 0.280534029006958,
      "eval_objectnav_pose_pose_mae_dx": 0.09383466839790344,
      "eval_objectnav_pose_pose_mae_dy": 0.05199155956506729,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.49523624777793884,
      "eval_objectnav_pose_pose_rmse_dx": 0.21548357605934143,
      "eval_objectnav_pose_pose_rmse_dy": 0.12666761875152588,
      "eval_objectnav_pose_pose_rmse_mean": 0.27912914752960205,
      "eval_objectnav_pose_rmse_dtheta": 0.054740507155656815,
      "eval_objectnav_pose_rmse_dx": 0.024192996323108673,
      "eval_objectnav_pose_rmse_dy": 0.010494804941117764,
      "eval_objectnav_pose_rmse_mean": 0.029809437692165375,
      "eval_objectnav_pose_rotation_flip": 0.015917276963591576,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28891217708587646,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 4400
    },
    {
      "epoch": 0.20442296970823268,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09792869538068771,
      "eval_pointnav_mae_dtheta": 0.011454138904809952,
      "eval_pointnav_mae_dx": 0.0026999027468264103,
      "eval_pointnav_mae_dy": 0.0026335783768445253,
      "eval_pointnav_pose_mae_dtheta": 0.08048170804977417,
      "eval_pointnav_pose_mae_dx": 0.028915666043758392,
      "eval_pointnav_pose_mae_dy": 0.028852766379714012,
      "eval_pointnav_pose_rmse_dtheta": 0.2233506441116333,
      "eval_pointnav_pose_rmse_dx": 0.08299139142036438,
      "eval_pointnav_pose_rmse_dy": 0.08077865839004517,
      "eval_pointnav_pose_rmse_mean": 0.12904024124145508,
      "eval_pointnav_rmse_dtheta": 0.027335945516824722,
      "eval_pointnav_rmse_dx": 0.008215953595936298,
      "eval_pointnav_rmse_dy": 0.006897422950714827,
      "eval_pointnav_rmse_mean": 0.014149773865938187,
      "eval_pointnav_rotation_flip": 0.005602000746876001,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09792869538068771,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 4400
    },
    {
      "epoch": 0.20442296970823268,
      "eval_loss": 0.23542685061693192,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31943967938423157,
      "eval_objectnav_nopose_mae_dtheta": 0.04102570563554764,
      "eval_objectnav_nopose_mae_dx": 0.013305059634149075,
      "eval_objectnav_nopose_mae_dy": 0.005236650817096233,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3336365222930908,
      "eval_objectnav_nopose_pose_mae_dx": 0.1064949631690979,
      "eval_objectnav_nopose_pose_mae_dy": 0.05890965089201927,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5584839582443237,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2346128523349762,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13958999514579773,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3108956217765808,
      "eval_objectnav_nopose_rmse_dtheta": 0.05900822952389717,
      "eval_objectnav_nopose_rmse_dx": 0.026217589154839516,
      "eval_objectnav_nopose_rmse_dy": 0.011027045547962189,
      "eval_objectnav_nopose_rmse_mean": 0.03208428993821144,
      "eval_objectnav_nopose_rotation_flip": 0.015935329720377922,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31943967938423157,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28891217708587646,
      "eval_objectnav_pose_mae_dtheta": 0.03656933456659317,
      "eval_objectnav_pose_mae_dx": 0.011667207814753056,
      "eval_objectnav_pose_mae_dy": 0.004870851989835501,
      "eval_objectnav_pose_pose_mae_dtheta": 0.280534029006958,
      "eval_objectnav_pose_pose_mae_dx": 0.09383466839790344,
      "eval_objectnav_pose_pose_mae_dy": 0.05199155956506729,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.49523624777793884,
      "eval_objectnav_pose_pose_rmse_dx": 0.21548357605934143,
      "eval_objectnav_pose_pose_rmse_dy": 0.12666761875152588,
      "eval_objectnav_pose_pose_rmse_mean": 0.27912914752960205,
      "eval_objectnav_pose_rmse_dtheta": 0.054740507155656815,
      "eval_objectnav_pose_rmse_dx": 0.024192996323108673,
      "eval_objectnav_pose_rmse_dy": 0.010494804941117764,
      "eval_objectnav_pose_rmse_mean": 0.029809437692165375,
      "eval_objectnav_pose_rotation_flip": 0.015917276963591576,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28891217708587646,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09792869538068771,
      "eval_pointnav_mae_dtheta": 0.011454138904809952,
      "eval_pointnav_mae_dx": 0.0026999027468264103,
      "eval_pointnav_mae_dy": 0.0026335783768445253,
      "eval_pointnav_pose_mae_dtheta": 0.08048170804977417,
      "eval_pointnav_pose_mae_dx": 0.028915666043758392,
      "eval_pointnav_pose_mae_dy": 0.028852766379714012,
      "eval_pointnav_pose_rmse_dtheta": 0.2233506441116333,
      "eval_pointnav_pose_rmse_dx": 0.08299139142036438,
      "eval_pointnav_pose_rmse_dy": 0.08077865839004517,
      "eval_pointnav_pose_rmse_mean": 0.12904024124145508,
      "eval_pointnav_rmse_dtheta": 0.027335945516824722,
      "eval_pointnav_rmse_dx": 0.008215953595936298,
      "eval_pointnav_rmse_dy": 0.006897422950714827,
      "eval_pointnav_rmse_mean": 0.014149773865938187,
      "eval_pointnav_rotation_flip": 0.005602000746876001,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09792869538068771,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 4400
    },
    {
      "dense_tokens": 32662.0,
      "epoch": 0.20446942947407545,
      "grad_norm": 0.5435064435005188,
      "learning_rate": 7.1250672812001505e-06,
      "loss": 0.1546,
      "mae_dtheta": 0.03387298434972763,
      "mae_dx": 0.014872393570840359,
      "mae_dy": 0.006886946968734264,
      "pose_mae_dtheta": 0.2602907717227936,
      "pose_mae_dx": 0.1182122677564621,
      "pose_mae_dy": 0.09019624441862106,
      "pose_rmse_dtheta": 0.43167805671691895,
      "pose_rmse_dx": 0.2536695599555969,
      "pose_rmse_dy": 0.18950945138931274,
      "pose_rmse_mean": 0.29161903262138367,
      "rmse_dtheta": 0.04889686778187752,
      "rmse_dx": 0.028524672612547874,
      "rmse_dy": 0.013348742388188839,
      "rmse_mean": 0.030256761237978935,
      "rotation_flip": 0.015655577182769775,
      "sparse_tokens": 25988.0,
      "step": 4401,
      "turn_loss": 0.2770974040031433,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.20451588923991823,
      "grad_norm": 0.3552994430065155,
      "learning_rate": 7.123870351300991e-06,
      "loss": 0.0939,
      "mae_dtheta": 0.011490775272250175,
      "mae_dx": 0.0018249040003865957,
      "mae_dy": 0.0025135125033557415,
      "pose_mae_dtheta": 0.07447803765535355,
      "pose_mae_dx": 0.02572883479297161,
      "pose_mae_dy": 0.03025149554014206,
      "pose_rmse_dtheta": 0.17151890695095062,
      "pose_rmse_dx": 0.05678423121571541,
      "pose_rmse_dy": 0.06502076983451843,
      "pose_rmse_mean": 0.09777463972568512,
      "rmse_dtheta": 0.022979967296123505,
      "rmse_dx": 0.0049123684875667095,
      "rmse_dy": 0.0048027946613729,
      "rmse_mean": 0.010898376815021038,
      "rotation_flip": 0.00453277537599206,
      "sparse_tokens": 32137.0,
      "step": 4402,
      "turn_loss": 0.09504327923059464,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.204562349005761,
      "grad_norm": 0.5780792236328125,
      "learning_rate": 7.122673272878438e-06,
      "loss": 0.1843,
      "mae_dtheta": 0.03290366381406784,
      "mae_dx": 0.013214098289608955,
      "mae_dy": 0.005396681372076273,
      "pose_mae_dtheta": 0.28886330127716064,
      "pose_mae_dx": 0.11721394211053848,
      "pose_mae_dy": 0.08534643054008484,
      "pose_rmse_dtheta": 0.48753222823143005,
      "pose_rmse_dx": 0.23057198524475098,
      "pose_rmse_dy": 0.22724279761314392,
      "pose_rmse_mean": 0.31511569023132324,
      "rmse_dtheta": 0.05027604475617409,
      "rmse_dx": 0.025015240535140038,
      "rmse_dy": 0.011765946634113789,
      "rmse_mean": 0.029019078239798546,
      "rotation_flip": 0.011976048350334167,
      "sparse_tokens": 20449.0,
      "step": 4403,
      "turn_loss": 0.23929555714130402,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.20460880877160378,
      "grad_norm": 0.4158436357975006,
      "learning_rate": 7.121476046016202e-06,
      "loss": 0.1092,
      "mae_dtheta": 0.038794662803411484,
      "mae_dx": 0.016561593860387802,
      "mae_dy": 0.014876398257911205,
      "pose_mae_dtheta": 0.2794431447982788,
      "pose_mae_dx": 0.10879198461771011,
      "pose_mae_dy": 0.17118483781814575,
      "pose_rmse_dtheta": 0.4185953438282013,
      "pose_rmse_dx": 0.19062067568302155,
      "pose_rmse_dy": 0.31333303451538086,
      "pose_rmse_mean": 0.3075163662433624,
      "rmse_dtheta": 0.056045860052108765,
      "rmse_dx": 0.02769375406205654,
      "rmse_dy": 0.02598172053694725,
      "rmse_mean": 0.036573778837919235,
      "rotation_flip": 0.012861736118793488,
      "sparse_tokens": 5553.0,
      "step": 4404,
      "turn_loss": 0.5920713543891907,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.20465526853744656,
      "grad_norm": 0.5448243021965027,
      "learning_rate": 7.12027867079801e-06,
      "loss": 0.1425,
      "mae_dtheta": 0.03519679605960846,
      "mae_dx": 0.0078195258975029,
      "mae_dy": 0.0028413638938218355,
      "pose_mae_dtheta": 0.27685976028442383,
      "pose_mae_dx": 0.05976707115769386,
      "pose_mae_dy": 0.026804527267813683,
      "pose_rmse_dtheta": 0.5222322940826416,
      "pose_rmse_dx": 0.1666923463344574,
      "pose_rmse_dy": 0.06196914240717888,
      "pose_rmse_mean": 0.2502979636192322,
      "rmse_dtheta": 0.056817200034856796,
      "rmse_dx": 0.018158869817852974,
      "rmse_dy": 0.007509622257202864,
      "rmse_mean": 0.027495231479406357,
      "rotation_flip": 0.013392857275903225,
      "sparse_tokens": 8042.0,
      "step": 4405,
      "turn_loss": 0.1910165697336197,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.20470172830328934,
      "grad_norm": 0.5723075866699219,
      "learning_rate": 7.119081147307591e-06,
      "loss": 0.1904,
      "mae_dtheta": 0.028088141232728958,
      "mae_dx": 0.00930018536746502,
      "mae_dy": 0.005325565580278635,
      "pose_mae_dtheta": 0.21017587184906006,
      "pose_mae_dx": 0.06969638168811798,
      "pose_mae_dy": 0.07321783900260925,
      "pose_rmse_dtheta": 0.3830859661102295,
      "pose_rmse_dx": 0.1881376951932907,
      "pose_rmse_dy": 0.1463107317686081,
      "pose_rmse_mean": 0.2391781508922577,
      "rmse_dtheta": 0.043739862740039825,
      "rmse_dx": 0.022125307470560074,
      "rmse_dy": 0.008998970501124859,
      "rmse_mean": 0.024954713881015778,
      "rotation_flip": 0.013863216154277325,
      "sparse_tokens": 17800.0,
      "step": 4406,
      "turn_loss": 0.21146848797798157,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.20474818806913214,
      "grad_norm": 0.4184909164905548,
      "learning_rate": 7.117883475628691e-06,
      "loss": 0.1386,
      "mae_dtheta": 0.035536497831344604,
      "mae_dx": 0.007373694330453873,
      "mae_dy": 0.002381442114710808,
      "pose_mae_dtheta": 0.3281715214252472,
      "pose_mae_dx": 0.060373976826667786,
      "pose_mae_dy": 0.031199781224131584,
      "pose_rmse_dtheta": 0.6636120080947876,
      "pose_rmse_dx": 0.12999501824378967,
      "pose_rmse_dy": 0.10092707723379135,
      "pose_rmse_mean": 0.2981780171394348,
      "rmse_dtheta": 0.06134512275457382,
      "rmse_dx": 0.01695995032787323,
      "rmse_dy": 0.005116460844874382,
      "rmse_mean": 0.02780717983841896,
      "rotation_flip": 0.006042296066880226,
      "sparse_tokens": 6220.0,
      "step": 4407,
      "turn_loss": 0.21876998245716095,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.20479464783497492,
      "grad_norm": 0.5161280035972595,
      "learning_rate": 7.11668565584506e-06,
      "loss": 0.0952,
      "mae_dtheta": 0.03861470893025398,
      "mae_dx": 0.011023328639566898,
      "mae_dy": 0.002847204217687249,
      "pose_mae_dtheta": 0.2999567687511444,
      "pose_mae_dx": 0.07246409356594086,
      "pose_mae_dy": 0.037993911653757095,
      "pose_rmse_dtheta": 0.579290509223938,
      "pose_rmse_dx": 0.1888500303030014,
      "pose_rmse_dy": 0.10976140946149826,
      "pose_rmse_mean": 0.2926340103149414,
      "rmse_dtheta": 0.06211027503013611,
      "rmse_dx": 0.023472461849451065,
      "rmse_dy": 0.006260125897824764,
      "rmse_mean": 0.03061428666114807,
      "rotation_flip": 0.014732965268194675,
      "sparse_tokens": 9219.0,
      "step": 4408,
      "turn_loss": 0.2363240122795105,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.2048411076008177,
      "grad_norm": 0.9535775184631348,
      "learning_rate": 7.115487688040468e-06,
      "loss": 0.1702,
      "mae_dtheta": 0.040165096521377563,
      "mae_dx": 0.01587499864399433,
      "mae_dy": 0.018481409177184105,
      "pose_mae_dtheta": 0.29455676674842834,
      "pose_mae_dx": 0.1580166220664978,
      "pose_mae_dy": 0.2043096274137497,
      "pose_rmse_dtheta": 0.418284147977829,
      "pose_rmse_dx": 0.2827453911304474,
      "pose_rmse_dy": 0.3667583763599396,
      "pose_rmse_mean": 0.35592931509017944,
      "rmse_dtheta": 0.04943569377064705,
      "rmse_dx": 0.028766315430402756,
      "rmse_dy": 0.029985502362251282,
      "rmse_mean": 0.03606250509619713,
      "rotation_flip": 0.00803212821483612,
      "sparse_tokens": 3994.0,
      "step": 4409,
      "turn_loss": 0.43672820925712585,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.20488756736666047,
      "grad_norm": 0.5232354402542114,
      "learning_rate": 7.114289572298685e-06,
      "loss": 0.166,
      "mae_dtheta": 0.00963881891220808,
      "mae_dx": 0.001081988331861794,
      "mae_dy": 0.0020823918748646975,
      "pose_mae_dtheta": 0.06832926720380783,
      "pose_mae_dx": 0.017243370413780212,
      "pose_mae_dy": 0.030722595751285553,
      "pose_rmse_dtheta": 0.204945370554924,
      "pose_rmse_dx": 0.04452875629067421,
      "pose_rmse_dy": 0.06911470741033554,
      "pose_rmse_mean": 0.10619627684354782,
      "rmse_dtheta": 0.023660873994231224,
      "rmse_dx": 0.003445477457717061,
      "rmse_dy": 0.004392076283693314,
      "rmse_mean": 0.010499476455152035,
      "rotation_flip": 0.006224066484719515,
      "sparse_tokens": 32025.0,
      "step": 4410,
      "turn_loss": 0.07160116732120514,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.20493402713250325,
      "grad_norm": 0.6337928771972656,
      "learning_rate": 7.113091308703498e-06,
      "loss": 0.2077,
      "mae_dtheta": 0.03636399656534195,
      "mae_dx": 0.013465764932334423,
      "mae_dy": 0.009562639519572258,
      "pose_mae_dtheta": 0.29706481099128723,
      "pose_mae_dx": 0.1096537709236145,
      "pose_mae_dy": 0.10884007811546326,
      "pose_rmse_dtheta": 0.49704933166503906,
      "pose_rmse_dx": 0.23648755252361298,
      "pose_rmse_dy": 0.2038230001926422,
      "pose_rmse_mean": 0.31245332956314087,
      "rmse_dtheta": 0.05080912262201309,
      "rmse_dx": 0.025929013267159462,
      "rmse_dy": 0.016469648107886314,
      "rmse_mean": 0.031069261953234673,
      "rotation_flip": 0.008840864524245262,
      "sparse_tokens": 16057.0,
      "step": 4411,
      "turn_loss": 0.3332042396068573,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.20498048689834603,
      "grad_norm": 0.8799784183502197,
      "learning_rate": 7.111892897338701e-06,
      "loss": 0.2978,
      "mae_dtheta": 0.027848845347762108,
      "mae_dx": 0.009220948442816734,
      "mae_dy": 0.006828443147242069,
      "pose_mae_dtheta": 0.22114963829517365,
      "pose_mae_dx": 0.0885147824883461,
      "pose_mae_dy": 0.06921567022800446,
      "pose_rmse_dtheta": 0.3899715542793274,
      "pose_rmse_dx": 0.17565079033374786,
      "pose_rmse_dy": 0.15445370972156525,
      "pose_rmse_mean": 0.2400253415107727,
      "rmse_dtheta": 0.043559711426496506,
      "rmse_dx": 0.018384993076324463,
      "rmse_dy": 0.01399446651339531,
      "rmse_mean": 0.025313057005405426,
      "rotation_flip": 0.027397260069847107,
      "sparse_tokens": 9753.0,
      "step": 4412,
      "turn_loss": 0.2981961667537689,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 13323.0,
      "epoch": 0.2050269466641888,
      "grad_norm": 0.8070802688598633,
      "learning_rate": 7.110694338288101e-06,
      "loss": 0.1185,
      "mae_dtheta": 0.028208743780851364,
      "mae_dx": 0.007845914922654629,
      "mae_dy": 0.0057882219552993774,
      "pose_mae_dtheta": 0.20838278532028198,
      "pose_mae_dx": 0.06259570270776749,
      "pose_mae_dy": 0.0898861363530159,
      "pose_rmse_dtheta": 0.38198816776275635,
      "pose_rmse_dx": 0.16233259439468384,
      "pose_rmse_dy": 0.21294119954109192,
      "pose_rmse_mean": 0.25242066383361816,
      "rmse_dtheta": 0.04403205215930939,
      "rmse_dx": 0.020431235432624817,
      "rmse_dy": 0.012395423837006092,
      "rmse_mean": 0.025619572028517723,
      "rotation_flip": 0.009615384973585606,
      "sparse_tokens": 10678.0,
      "step": 4413,
      "turn_loss": 0.23563838005065918,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.20507340643003158,
      "grad_norm": 0.6532665491104126,
      "learning_rate": 7.109495631635512e-06,
      "loss": 0.1403,
      "mae_dtheta": 0.03399057686328888,
      "mae_dx": 0.00969589501619339,
      "mae_dy": 0.0040392628870904446,
      "pose_mae_dtheta": 0.26137688755989075,
      "pose_mae_dx": 0.08134725689888,
      "pose_mae_dy": 0.04803644120693207,
      "pose_rmse_dtheta": 0.4345049560070038,
      "pose_rmse_dx": 0.17477557063102722,
      "pose_rmse_dy": 0.12034092098474503,
      "pose_rmse_mean": 0.2432071566581726,
      "rmse_dtheta": 0.05122344195842743,
      "rmse_dx": 0.0199942197650671,
      "rmse_dy": 0.010066133923828602,
      "rmse_mean": 0.027094600722193718,
      "rotation_flip": 0.01621621660888195,
      "sparse_tokens": 12557.0,
      "step": 4414,
      "turn_loss": 0.2151859700679779,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.20511986619587438,
      "grad_norm": 0.34191063046455383,
      "learning_rate": 7.108296777464763e-06,
      "loss": 0.0683,
      "mae_dtheta": 0.00853085145354271,
      "mae_dx": 0.002353944117203355,
      "mae_dy": 0.0028832599055022,
      "pose_mae_dtheta": 0.05636436492204666,
      "pose_mae_dx": 0.03152276575565338,
      "pose_mae_dy": 0.028046833351254463,
      "pose_rmse_dtheta": 0.11661121249198914,
      "pose_rmse_dx": 0.08177008479833603,
      "pose_rmse_dy": 0.06822485476732254,
      "pose_rmse_mean": 0.08886872231960297,
      "rmse_dtheta": 0.017919596284627914,
      "rmse_dx": 0.006301608867943287,
      "rmse_dy": 0.006374862510710955,
      "rmse_mean": 0.010198689065873623,
      "rotation_flip": 0.0045008184388279915,
      "sparse_tokens": 32105.0,
      "step": 4415,
      "turn_loss": 0.07898833602666855,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.20516632596171716,
      "grad_norm": 0.5610671043395996,
      "learning_rate": 7.107097775859688e-06,
      "loss": 0.1231,
      "mae_dtheta": 0.011976555921137333,
      "mae_dx": 0.0017989331390708685,
      "mae_dy": 0.0014583099400624633,
      "pose_mae_dtheta": 0.08452978730201721,
      "pose_mae_dx": 0.01784193329513073,
      "pose_mae_dy": 0.0191881712526083,
      "pose_rmse_dtheta": 0.2682258188724518,
      "pose_rmse_dx": 0.04155237600207329,
      "pose_rmse_dy": 0.05001932755112648,
      "pose_rmse_mean": 0.11993250250816345,
      "rmse_dtheta": 0.030906330794095993,
      "rmse_dx": 0.0051879314705729485,
      "rmse_dy": 0.0033886495511978865,
      "rmse_mean": 0.01316097192466259,
      "rotation_flip": 0.009557344019412994,
      "sparse_tokens": 32137.0,
      "step": 4416,
      "turn_loss": 0.08475861698389053,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.20521278572755994,
      "grad_norm": 0.43894699215888977,
      "learning_rate": 7.105898626904134e-06,
      "loss": 0.0897,
      "mae_dtheta": 0.008482995443046093,
      "mae_dx": 0.0019454214489087462,
      "mae_dy": 0.001753877499140799,
      "pose_mae_dtheta": 0.056205231696367264,
      "pose_mae_dx": 0.019578127190470695,
      "pose_mae_dy": 0.018856870010495186,
      "pose_rmse_dtheta": 0.13299068808555603,
      "pose_rmse_dx": 0.05105625465512276,
      "pose_rmse_dy": 0.046772170811891556,
      "pose_rmse_mean": 0.07693970203399658,
      "rmse_dtheta": 0.020428957417607307,
      "rmse_dx": 0.005464422982186079,
      "rmse_dy": 0.004208797588944435,
      "rmse_mean": 0.01003406010568142,
      "rotation_flip": 0.00543970987200737,
      "sparse_tokens": 32137.0,
      "step": 4417,
      "turn_loss": 0.07600172609090805,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20525924549340271,
      "grad_norm": 0.7680345773696899,
      "learning_rate": 7.104699330681959e-06,
      "loss": 0.2128,
      "mae_dtheta": 0.012614957056939602,
      "mae_dx": 0.0018722302047535777,
      "mae_dy": 0.0023955872748047113,
      "pose_mae_dtheta": 0.08227109909057617,
      "pose_mae_dx": 0.022570708766579628,
      "pose_mae_dy": 0.03265568986535072,
      "pose_rmse_dtheta": 0.16503727436065674,
      "pose_rmse_dx": 0.06045929342508316,
      "pose_rmse_dy": 0.06765490025281906,
      "pose_rmse_mean": 0.09771715849637985,
      "rmse_dtheta": 0.024349160492420197,
      "rmse_dx": 0.006130324210971594,
      "rmse_dy": 0.0049600787460803986,
      "rmse_mean": 0.011813188903033733,
      "rotation_flip": 0.0062761506997048855,
      "sparse_tokens": 32073.0,
      "step": 4418,
      "turn_loss": 0.09591036289930344,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2053057052592455,
      "grad_norm": 0.5482008457183838,
      "learning_rate": 7.10349988727703e-06,
      "loss": 0.0898,
      "mae_dtheta": 0.004822932183742523,
      "mae_dx": 0.001039438066072762,
      "mae_dy": 0.0004632601048797369,
      "pose_mae_dtheta": 0.03465883061289787,
      "pose_mae_dx": 0.00813661515712738,
      "pose_mae_dy": 0.008132618851959705,
      "pose_rmse_dtheta": 0.14971931278705597,
      "pose_rmse_dx": 0.022894617170095444,
      "pose_rmse_dy": 0.027820950374007225,
      "pose_rmse_mean": 0.06681162863969803,
      "rmse_dtheta": 0.019859906286001205,
      "rmse_dx": 0.003644112264737487,
      "rmse_dy": 0.0010176078649237752,
      "rmse_mean": 0.008173875510692596,
      "rotation_flip": 0.0025359257124364376,
      "sparse_tokens": 32073.0,
      "step": 4419,
      "turn_loss": 0.03181596100330353,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.20535216502508827,
      "grad_norm": 0.5375978350639343,
      "learning_rate": 7.102300296773225e-06,
      "loss": 0.1156,
      "mae_dtheta": 0.014798221178352833,
      "mae_dx": 0.004073355346918106,
      "mae_dy": 0.004938943777233362,
      "pose_mae_dtheta": 0.11242165416479111,
      "pose_mae_dx": 0.04452342540025711,
      "pose_mae_dy": 0.040985748171806335,
      "pose_rmse_dtheta": 0.27616482973098755,
      "pose_rmse_dx": 0.11284487694501877,
      "pose_rmse_dy": 0.09194202721118927,
      "pose_rmse_mean": 0.16031724214553833,
      "rmse_dtheta": 0.030861500650644302,
      "rmse_dx": 0.010705266147851944,
      "rmse_dy": 0.011518800631165504,
      "rmse_mean": 0.017695188522338867,
      "rotation_flip": 0.005780346691608429,
      "sparse_tokens": 32105.0,
      "step": 4420,
      "turn_loss": 0.13738121092319489,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.20539862479093104,
      "grad_norm": 0.5395152568817139,
      "learning_rate": 7.1011005592544314e-06,
      "loss": 0.118,
      "mae_dtheta": 0.01705552078783512,
      "mae_dx": 0.0038533040788024664,
      "mae_dy": 0.0058229281567037106,
      "pose_mae_dtheta": 0.11487174779176712,
      "pose_mae_dx": 0.05804898589849472,
      "pose_mae_dy": 0.06268513947725296,
      "pose_rmse_dtheta": 0.21353109180927277,
      "pose_rmse_dx": 0.12795862555503845,
      "pose_rmse_dy": 0.12399015575647354,
      "pose_rmse_mean": 0.15515996515750885,
      "rmse_dtheta": 0.02862675115466118,
      "rmse_dx": 0.009604749269783497,
      "rmse_dy": 0.010632172226905823,
      "rmse_mean": 0.016287891194224358,
      "rotation_flip": 0.006646525580435991,
      "sparse_tokens": 32121.0,
      "step": 4421,
      "turn_loss": 0.17277884483337402,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.20544508455677382,
      "grad_norm": 0.7145341634750366,
      "learning_rate": 7.099900674804548e-06,
      "loss": 0.1695,
      "mae_dtheta": 0.030684862285852432,
      "mae_dx": 0.010804440826177597,
      "mae_dy": 0.0026948563754558563,
      "pose_mae_dtheta": 0.2481992244720459,
      "pose_mae_dx": 0.0811648815870285,
      "pose_mae_dy": 0.028988301753997803,
      "pose_rmse_dtheta": 0.47876691818237305,
      "pose_rmse_dx": 0.17516829073429108,
      "pose_rmse_dy": 0.07137390971183777,
      "pose_rmse_mean": 0.2417697161436081,
      "rmse_dtheta": 0.05169476941227913,
      "rmse_dx": 0.022600434720516205,
      "rmse_dy": 0.005574808921664953,
      "rmse_mean": 0.02662333846092224,
      "rotation_flip": 0.00730816088616848,
      "sparse_tokens": 14679.0,
      "step": 4422,
      "turn_loss": 0.2313002198934555,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.20549154432261663,
      "grad_norm": 0.494803249835968,
      "learning_rate": 7.098700643507485e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.011176085099577904,
      "mae_dx": 0.002081601181998849,
      "mae_dy": 0.002569688018411398,
      "pose_mae_dtheta": 0.07162542641162872,
      "pose_mae_dx": 0.02556215412914753,
      "pose_mae_dy": 0.02638043835759163,
      "pose_rmse_dtheta": 0.17563726007938385,
      "pose_rmse_dx": 0.059724900871515274,
      "pose_rmse_dy": 0.056690286844968796,
      "pose_rmse_mean": 0.0973508208990097,
      "rmse_dtheta": 0.0236497949808836,
      "rmse_dx": 0.005295981653034687,
      "rmse_dy": 0.00566732557490468,
      "rmse_mean": 0.011537700891494751,
      "rotation_flip": 0.006924198474735022,
      "sparse_tokens": 32169.0,
      "step": 4423,
      "turn_loss": 0.0925469920039177,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 41213.0,
      "epoch": 0.2055380040884594,
      "grad_norm": 0.5746647119522095,
      "learning_rate": 7.097500465447158e-06,
      "loss": 0.1484,
      "mae_dtheta": 0.03712144494056702,
      "mae_dx": 0.009716191329061985,
      "mae_dy": 0.005231832154095173,
      "pose_mae_dtheta": 0.2781369388103485,
      "pose_mae_dx": 0.07336058467626572,
      "pose_mae_dy": 0.05774620920419693,
      "pose_rmse_dtheta": 0.4699433147907257,
      "pose_rmse_dx": 0.18340249359607697,
      "pose_rmse_dy": 0.1523258239030838,
      "pose_rmse_mean": 0.26855722069740295,
      "rmse_dtheta": 0.055290527641773224,
      "rmse_dx": 0.021314244717359543,
      "rmse_dy": 0.01222444511950016,
      "rmse_mean": 0.029609737917780876,
      "rotation_flip": 0.01600753329694271,
      "sparse_tokens": 30113.0,
      "step": 4424,
      "turn_loss": 0.2767685353755951,
      "turns": 127.0,
      "turns_per_sample": 127.0
    },
    {
      "dense_tokens": 19096.0,
      "epoch": 0.20558446385430218,
      "grad_norm": 0.5781851410865784,
      "learning_rate": 7.096300140707497e-06,
      "loss": 0.1738,
      "mae_dtheta": 0.03989564627408981,
      "mae_dx": 0.01556888036429882,
      "mae_dy": 0.008250333368778229,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5781849026679993,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 135.9609375,
      "model/head/act_norm_mean": 111.72480799788136,
      "model/head/act_norm_min": 83.44266510009766,
      "model/head/act_over_embed": 76.77833404027629,
      "model/head/grad_frac": 0.11623480916023254,
      "model/head/grad_norm": 0.06720521301031113,
      "model/head/grad_zero_frac": 0.00018750761228147894,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6981263241525424,
      "model/head/update_ratio": 0.0011532003991305828,
      "model/head/weight_delta": 7.83529806137085,
      "model/head/weight_delta_rel": 0.1374543309211731,
      "model/head/weight_norm": 58.27713394165039,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41862794756889343,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41862794756889343,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41862794756889343,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2876850448259376,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08008778095245361,
      "model/modality_embedder.encoders.pose/grad_norm": 0.046305544674396515,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.00149895204231143,
      "model/modality_embedder.encoders.pose/weight_delta": 2.571157217025757,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08400771766901016,
      "model/modality_embedder.encoders.pose/weight_norm": 30.891944885253906,
      "model/modality_embedder/grad_frac": 0.08008778095245361,
      "model/modality_embedder/grad_norm": 0.046305544674396515,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.00149895204231143,
      "model/modality_embedder/weight_delta": 2.571157217025757,
      "model/modality_embedder/weight_delta_rel": 0.08400771766901016,
      "model/modality_embedder/weight_norm": 30.891944885253906,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.54547119140625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.813920836696262,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.168970108032227,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.36514934841717,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11177235841751099,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0646250918507576,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0023266610223799944,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.879072666168213,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06847453862428665,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.775894165039062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.87471771240234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.61175847457627,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.59597110748291,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.91343084264196,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.11343225091695786,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06558481603860855,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0022259284742176533,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.375957727432251,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08230502903461456,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.464027404785156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.40766906738281,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.221490785579768,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.68690013885498,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.0196539573149,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.1113780066370964,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06439708173274994,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0021171425469219685,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.552462100982666,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08570689707994461,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.416980743408203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.11766815185547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.231098247914986,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.379154205322266,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.400675019673148,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11549403518438339,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06677690893411636,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022472080308943987,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.1785097122192383,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07445112615823746,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.715499877929688,
      "model/normalizer/grad_frac": 0.3846231698989868,
      "model/normalizer/grad_norm": 0.2223833054304123,
      "model/normalizer/grad_zero_frac": 0.0001607164304004982,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002839638851583004,
      "model/normalizer/weight_delta": 4.626421928405762,
      "model/normalizer/weight_delta_rel": 0.059585634618997574,
      "model/normalizer/weight_norm": 78.3139419555664,
      "pose_mae_dtheta": 0.337782084941864,
      "pose_mae_dx": 0.12112296372652054,
      "pose_mae_dy": 0.08341838419437408,
      "pose_rmse_dtheta": 0.578590452671051,
      "pose_rmse_dx": 0.27804261445999146,
      "pose_rmse_dy": 0.19789467751979828,
      "pose_rmse_mean": 0.3515092730522156,
      "rmse_dtheta": 0.05922373756766319,
      "rmse_dx": 0.029639916494488716,
      "rmse_dy": 0.018266336992383003,
      "rmse_mean": 0.03570999950170517,
      "rotation_flip": 0.011086474172770977,
      "sparse_tokens": 15057.0,
      "step": 4425,
      "turn_loss": 0.3235921561717987,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20563092362014496,
      "grad_norm": 0.40958186984062195,
      "learning_rate": 7.095099669372444e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.01436485256999731,
      "mae_dx": 0.0017394381575286388,
      "mae_dy": 0.0027649649418890476,
      "pose_mae_dtheta": 0.09853970259428024,
      "pose_mae_dx": 0.02289201132953167,
      "pose_mae_dy": 0.036597199738025665,
      "pose_rmse_dtheta": 0.21759752929210663,
      "pose_rmse_dx": 0.05593641847372055,
      "pose_rmse_dy": 0.07618634402751923,
      "pose_rmse_mean": 0.11657343804836273,
      "rmse_dtheta": 0.027232469990849495,
      "rmse_dx": 0.006143124308437109,
      "rmse_dy": 0.004974334966391325,
      "rmse_mean": 0.012783310376107693,
      "rotation_flip": 0.0033992582466453314,
      "sparse_tokens": 32089.0,
      "step": 4426,
      "turn_loss": 0.10148489475250244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20567738338598773,
      "grad_norm": 0.3731152415275574,
      "learning_rate": 7.093899051525944e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.010674886405467987,
      "mae_dx": 0.0012726447312161326,
      "mae_dy": 0.002060243161395192,
      "pose_mae_dtheta": 0.07599636167287827,
      "pose_mae_dx": 0.019912708550691605,
      "pose_mae_dy": 0.03130631893873215,
      "pose_rmse_dtheta": 0.19488084316253662,
      "pose_rmse_dx": 0.055203136056661606,
      "pose_rmse_dy": 0.07592242956161499,
      "pose_rmse_mean": 0.10866880416870117,
      "rmse_dtheta": 0.023663636296987534,
      "rmse_dx": 0.003865323029458523,
      "rmse_dy": 0.0049889604561030865,
      "rmse_mean": 0.010839307680726051,
      "rotation_flip": 0.005723630543798208,
      "sparse_tokens": 32073.0,
      "step": 4427,
      "turn_loss": 0.08204378932714462,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2057238431518305,
      "grad_norm": 0.47848203778266907,
      "learning_rate": 7.092698287251961e-06,
      "loss": 0.079,
      "mae_dtheta": 0.008500204421579838,
      "mae_dx": 0.0016548105049878359,
      "mae_dy": 0.0011084573343396187,
      "pose_mae_dtheta": 0.06540924310684204,
      "pose_mae_dx": 0.014945960603654385,
      "pose_mae_dy": 0.019542094320058823,
      "pose_rmse_dtheta": 0.18085399270057678,
      "pose_rmse_dx": 0.0400041826069355,
      "pose_rmse_dy": 0.05332527309656143,
      "pose_rmse_mean": 0.09139448404312134,
      "rmse_dtheta": 0.021671321243047714,
      "rmse_dx": 0.005048773717135191,
      "rmse_dy": 0.00253659556619823,
      "rmse_mean": 0.00975223071873188,
      "rotation_flip": 0.004520341753959656,
      "sparse_tokens": 32121.0,
      "step": 4428,
      "turn_loss": 0.05203069746494293,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.2057703029176733,
      "grad_norm": 0.7807650566101074,
      "learning_rate": 7.0914973766344645e-06,
      "loss": 0.2078,
      "mae_dtheta": 0.04471119865775108,
      "mae_dx": 0.01592019945383072,
      "mae_dy": 0.008701956830918789,
      "pose_mae_dtheta": 0.31845009326934814,
      "pose_mae_dx": 0.1113814115524292,
      "pose_mae_dy": 0.09338172525167465,
      "pose_rmse_dtheta": 0.5511792898178101,
      "pose_rmse_dx": 0.2158423215150833,
      "pose_rmse_dy": 0.2056288719177246,
      "pose_rmse_mean": 0.3242168426513672,
      "rmse_dtheta": 0.06413109600543976,
      "rmse_dx": 0.027849629521369934,
      "rmse_dy": 0.017369363456964493,
      "rmse_mean": 0.03645002841949463,
      "rotation_flip": 0.01879194565117359,
      "sparse_tokens": 13845.0,
      "step": 4429,
      "turn_loss": 0.38820481300354004,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.20581676268351606,
      "grad_norm": 0.6395511627197266,
      "learning_rate": 7.0902963197574325e-06,
      "loss": 0.1612,
      "mae_dtheta": 0.04001244157552719,
      "mae_dx": 0.009062652476131916,
      "mae_dy": 0.0035683587193489075,
      "pose_mae_dtheta": 0.34220704436302185,
      "pose_mae_dx": 0.06755618005990982,
      "pose_mae_dy": 0.047009218484163284,
      "pose_rmse_dtheta": 0.6016371250152588,
      "pose_rmse_dx": 0.14976812899112701,
      "pose_rmse_dy": 0.11240654438734055,
      "pose_rmse_mean": 0.2879372835159302,
      "rmse_dtheta": 0.0625806674361229,
      "rmse_dx": 0.020076904445886612,
      "rmse_dy": 0.007226759102195501,
      "rmse_mean": 0.029961444437503815,
      "rotation_flip": 0.006896551698446274,
      "sparse_tokens": 15036.0,
      "step": 4430,
      "turn_loss": 0.2536555230617523,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.20586322244935887,
      "grad_norm": 0.4495663046836853,
      "learning_rate": 7.0890951167048586e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.01094823144376278,
      "mae_dx": 0.0018128061201423407,
      "mae_dy": 0.0025082281790673733,
      "pose_mae_dtheta": 0.07116285711526871,
      "pose_mae_dx": 0.021342014893889427,
      "pose_mae_dy": 0.028718847781419754,
      "pose_rmse_dtheta": 0.17754755914211273,
      "pose_rmse_dx": 0.057243358343839645,
      "pose_rmse_dy": 0.06371521949768066,
      "pose_rmse_mean": 0.09950204938650131,
      "rmse_dtheta": 0.023531606420874596,
      "rmse_dx": 0.005281645338982344,
      "rmse_dy": 0.00585644505918026,
      "rmse_mean": 0.011556565761566162,
      "rotation_flip": 0.005528934765607119,
      "sparse_tokens": 32121.0,
      "step": 4431,
      "turn_loss": 0.10202660411596298,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21425.0,
      "epoch": 0.20590968221520164,
      "grad_norm": 0.5499550104141235,
      "learning_rate": 7.08789376756074e-06,
      "loss": 0.1911,
      "mae_dtheta": 0.026892419904470444,
      "mae_dx": 0.010093963705003262,
      "mae_dy": 0.005654933396726847,
      "pose_mae_dtheta": 0.21036644279956818,
      "pose_mae_dx": 0.09473710507154465,
      "pose_mae_dy": 0.07839823514223099,
      "pose_rmse_dtheta": 0.35210779309272766,
      "pose_rmse_dx": 0.1928938925266266,
      "pose_rmse_dy": 0.16666829586029053,
      "pose_rmse_mean": 0.2372233271598816,
      "rmse_dtheta": 0.04085266590118408,
      "rmse_dx": 0.02055826038122177,
      "rmse_dy": 0.010065032169222832,
      "rmse_mean": 0.023825321346521378,
      "rotation_flip": 0.011439465917646885,
      "sparse_tokens": 17894.0,
      "step": 4432,
      "turn_loss": 0.23795026540756226,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.20595614198104442,
      "grad_norm": 0.6867092847824097,
      "learning_rate": 7.08669227240909e-06,
      "loss": 0.1449,
      "mae_dtheta": 0.04423758015036583,
      "mae_dx": 0.012736198492348194,
      "mae_dy": 0.003882966237142682,
      "pose_mae_dtheta": 0.36658573150634766,
      "pose_mae_dx": 0.09947362542152405,
      "pose_mae_dy": 0.051302604377269745,
      "pose_rmse_dtheta": 0.559727668762207,
      "pose_rmse_dx": 0.21318118274211884,
      "pose_rmse_dy": 0.14754600822925568,
      "pose_rmse_mean": 0.30681830644607544,
      "rmse_dtheta": 0.059991080313920975,
      "rmse_dx": 0.02527122013270855,
      "rmse_dy": 0.00817857775837183,
      "rmse_mean": 0.031146958470344543,
      "rotation_flip": 0.016867469996213913,
      "sparse_tokens": 12116.0,
      "step": 4433,
      "turn_loss": 0.31193622946739197,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 37315.0,
      "epoch": 0.2060026017468872,
      "grad_norm": 0.6034014225006104,
      "learning_rate": 7.08549063133393e-06,
      "loss": 0.1291,
      "mae_dtheta": 0.03234399855136871,
      "mae_dx": 0.010827994905412197,
      "mae_dy": 0.006332217250019312,
      "pose_mae_dtheta": 0.25792503356933594,
      "pose_mae_dx": 0.07962480187416077,
      "pose_mae_dy": 0.06770715117454529,
      "pose_rmse_dtheta": 0.4755156934261322,
      "pose_rmse_dx": 0.17228232324123383,
      "pose_rmse_dy": 0.1734035462141037,
      "pose_rmse_mean": 0.27373385429382324,
      "rmse_dtheta": 0.05155682563781738,
      "rmse_dx": 0.022151751443743706,
      "rmse_dy": 0.013305963017046452,
      "rmse_mean": 0.02900484763085842,
      "rotation_flip": 0.012650948949158192,
      "sparse_tokens": 29815.0,
      "step": 4434,
      "turn_loss": 0.2646018862724304,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.20604906151272998,
      "grad_norm": 0.5472884178161621,
      "learning_rate": 7.0842888444192905e-06,
      "loss": 0.1867,
      "mae_dtheta": 0.024398865178227425,
      "mae_dx": 0.00560643058270216,
      "mae_dy": 0.007053005509078503,
      "pose_mae_dtheta": 0.15116716921329498,
      "pose_mae_dx": 0.06198321655392647,
      "pose_mae_dy": 0.05748539790511131,
      "pose_rmse_dtheta": 0.23507800698280334,
      "pose_rmse_dx": 0.13400842249393463,
      "pose_rmse_dy": 0.1036350280046463,
      "pose_rmse_mean": 0.15757381916046143,
      "rmse_dtheta": 0.03623208776116371,
      "rmse_dx": 0.012257223017513752,
      "rmse_dy": 0.012854520231485367,
      "rmse_mean": 0.02044794335961342,
      "rotation_flip": 0.02857142873108387,
      "sparse_tokens": 3936.0,
      "step": 4435,
      "turn_loss": 0.3129749894142151,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.20609552127857275,
      "grad_norm": 0.48684775829315186,
      "learning_rate": 7.083086911749214e-06,
      "loss": 0.0938,
      "mae_dtheta": 0.02860361710190773,
      "mae_dx": 0.008055408485233784,
      "mae_dy": 0.004648236092180014,
      "pose_mae_dtheta": 0.23175033926963806,
      "pose_mae_dx": 0.08169423788785934,
      "pose_mae_dy": 0.0649791955947876,
      "pose_rmse_dtheta": 0.4828703999519348,
      "pose_rmse_dx": 0.18356089293956757,
      "pose_rmse_dy": 0.1810290813446045,
      "pose_rmse_mean": 0.28248679637908936,
      "rmse_dtheta": 0.050196677446365356,
      "rmse_dx": 0.018480492755770683,
      "rmse_dy": 0.009984347969293594,
      "rmse_mean": 0.02622050605714321,
      "rotation_flip": 0.01222826074808836,
      "sparse_tokens": 14084.0,
      "step": 4436,
      "turn_loss": 0.24264363944530487,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20614198104441553,
      "grad_norm": 0.6196049451828003,
      "learning_rate": 7.081884833407751e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.012425845488905907,
      "mae_dx": 0.00197482923977077,
      "mae_dy": 0.0030044903978705406,
      "pose_mae_dtheta": 0.08354618400335312,
      "pose_mae_dx": 0.03034093789756298,
      "pose_mae_dy": 0.039953917264938354,
      "pose_rmse_dtheta": 0.16709357500076294,
      "pose_rmse_dx": 0.07308083027601242,
      "pose_rmse_dy": 0.08463969826698303,
      "pose_rmse_mean": 0.10827137529850006,
      "rmse_dtheta": 0.022327644750475883,
      "rmse_dx": 0.005940581671893597,
      "rmse_dy": 0.005949812009930611,
      "rmse_mean": 0.011406011879444122,
      "rotation_flip": 0.00313152396120131,
      "sparse_tokens": 32073.0,
      "step": 4437,
      "turn_loss": 0.09594611823558807,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.2061884408102583,
      "grad_norm": 0.9908137917518616,
      "learning_rate": 7.080682609478964e-06,
      "loss": 0.1432,
      "mae_dtheta": 0.039519112557172775,
      "mae_dx": 0.011040796525776386,
      "mae_dy": 0.00614336458966136,
      "pose_mae_dtheta": 0.3029158115386963,
      "pose_mae_dx": 0.08023329079151154,
      "pose_mae_dy": 0.08293942362070084,
      "pose_rmse_dtheta": 0.5045920610427856,
      "pose_rmse_dx": 0.17679092288017273,
      "pose_rmse_dy": 0.18145869672298431,
      "pose_rmse_mean": 0.2876139283180237,
      "rmse_dtheta": 0.05699239298701286,
      "rmse_dx": 0.022565817460417747,
      "rmse_dy": 0.011561417020857334,
      "rmse_mean": 0.030373208224773407,
      "rotation_flip": 0.009022556245326996,
      "sparse_tokens": 10131.0,
      "step": 4438,
      "turn_loss": 0.24914315342903137,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 22072.0,
      "epoch": 0.2062349005761011,
      "grad_norm": 0.44445282220840454,
      "learning_rate": 7.079480240046926e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.03521190211176872,
      "mae_dx": 0.010283553041517735,
      "mae_dy": 0.004719195421785116,
      "pose_mae_dtheta": 0.25927966833114624,
      "pose_mae_dx": 0.083342045545578,
      "pose_mae_dy": 0.05778275057673454,
      "pose_rmse_dtheta": 0.4697076976299286,
      "pose_rmse_dx": 0.20577691495418549,
      "pose_rmse_dy": 0.1423010528087616,
      "pose_rmse_mean": 0.27259522676467896,
      "rmse_dtheta": 0.05350896716117859,
      "rmse_dx": 0.023195352405309677,
      "rmse_dy": 0.008816026151180267,
      "rmse_mean": 0.02850678376853466,
      "rotation_flip": 0.012621358968317509,
      "sparse_tokens": 17396.0,
      "step": 4439,
      "turn_loss": 0.23991495370864868,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.2062813603419439,
      "grad_norm": 0.5184367895126343,
      "learning_rate": 7.078277725195717e-06,
      "loss": 0.1314,
      "mae_dtheta": 0.04250611364841461,
      "mae_dx": 0.012418507598340511,
      "mae_dy": 0.0051339417695999146,
      "pose_mae_dtheta": 0.3591676354408264,
      "pose_mae_dx": 0.0861835926771164,
      "pose_mae_dy": 0.05578817427158356,
      "pose_rmse_dtheta": 0.6153191328048706,
      "pose_rmse_dx": 0.17768366634845734,
      "pose_rmse_dy": 0.15146449208259583,
      "pose_rmse_mean": 0.3148224353790283,
      "rmse_dtheta": 0.06305848807096481,
      "rmse_dx": 0.0248410701751709,
      "rmse_dy": 0.010085740126669407,
      "rmse_mean": 0.032661765813827515,
      "rotation_flip": 0.009685230441391468,
      "sparse_tokens": 7227.0,
      "step": 4440,
      "turn_loss": 0.2495264708995819,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.20632782010778666,
      "grad_norm": 0.5218873620033264,
      "learning_rate": 7.0770750650094335e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.01041562668979168,
      "mae_dx": 0.002403745660558343,
      "mae_dy": 0.0022143064998090267,
      "pose_mae_dtheta": 0.06906098872423172,
      "pose_mae_dx": 0.026463234797120094,
      "pose_mae_dy": 0.025562625378370285,
      "pose_rmse_dtheta": 0.14649170637130737,
      "pose_rmse_dx": 0.07377414405345917,
      "pose_rmse_dy": 0.05300724506378174,
      "pose_rmse_mean": 0.09109103679656982,
      "rmse_dtheta": 0.020665036514401436,
      "rmse_dx": 0.007568985689431429,
      "rmse_dy": 0.00481919851154089,
      "rmse_mean": 0.01101773977279663,
      "rotation_flip": 0.0032246506307274103,
      "sparse_tokens": 32121.0,
      "step": 4441,
      "turn_loss": 0.08548939228057861,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.20637427987362944,
      "grad_norm": 0.5214133262634277,
      "learning_rate": 7.075872259572174e-06,
      "loss": 0.0702,
      "mae_dtheta": 0.007817664183676243,
      "mae_dx": 0.0020997754763811827,
      "mae_dy": 0.002378394827246666,
      "pose_mae_dtheta": 0.05273383483290672,
      "pose_mae_dx": 0.02542586252093315,
      "pose_mae_dy": 0.022192848846316338,
      "pose_rmse_dtheta": 0.10475078225135803,
      "pose_rmse_dx": 0.05654988810420036,
      "pose_rmse_dy": 0.05242036655545235,
      "pose_rmse_mean": 0.07124035060405731,
      "rmse_dtheta": 0.01610550470650196,
      "rmse_dx": 0.00533809419721365,
      "rmse_dy": 0.0052331192418932915,
      "rmse_mean": 0.00889224000275135,
      "rotation_flip": 0.004471964202821255,
      "sparse_tokens": 32185.0,
      "step": 4442,
      "turn_loss": 0.07285848259925842,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.20642073963947222,
      "grad_norm": 0.5234739780426025,
      "learning_rate": 7.074669308968054e-06,
      "loss": 0.1412,
      "mae_dtheta": 0.009767549112439156,
      "mae_dx": 0.0016126979608088732,
      "mae_dy": 0.0020985035225749016,
      "pose_mae_dtheta": 0.06062996760010719,
      "pose_mae_dx": 0.016156017780303955,
      "pose_mae_dy": 0.017582708969712257,
      "pose_rmse_dtheta": 0.1922593116760254,
      "pose_rmse_dx": 0.04306822642683983,
      "pose_rmse_dy": 0.04949020594358444,
      "pose_rmse_mean": 0.09493925422430038,
      "rmse_dtheta": 0.026762234047055244,
      "rmse_dx": 0.004624592140316963,
      "rmse_dy": 0.006306772585958242,
      "rmse_mean": 0.012564532458782196,
      "rotation_flip": 0.007005253806710243,
      "sparse_tokens": 32169.0,
      "step": 4443,
      "turn_loss": 0.08753558993339539,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.206467199405315,
      "grad_norm": 1.2097902297973633,
      "learning_rate": 7.073466213281196e-06,
      "loss": 0.1412,
      "mae_dtheta": 0.026317309588193893,
      "mae_dx": 0.008877773769199848,
      "mae_dy": 0.004058259539306164,
      "pose_mae_dtheta": 0.16388484835624695,
      "pose_mae_dx": 0.0676809549331665,
      "pose_mae_dy": 0.050386957824230194,
      "pose_rmse_dtheta": 0.2970133125782013,
      "pose_rmse_dx": 0.17979493737220764,
      "pose_rmse_dy": 0.10825295746326447,
      "pose_rmse_mean": 0.1950204074382782,
      "rmse_dtheta": 0.04418569430708885,
      "rmse_dx": 0.02127334475517273,
      "rmse_dy": 0.007218070328235626,
      "rmse_mean": 0.02422570437192917,
      "rotation_flip": 0.016293279826641083,
      "sparse_tokens": 8369.0,
      "step": 4444,
      "turn_loss": 0.23141947388648987,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20651365917115777,
      "grad_norm": 0.3953610062599182,
      "learning_rate": 7.072262972595733e-06,
      "loss": 0.0924,
      "mae_dtheta": 0.008742595091462135,
      "mae_dx": 0.001833275775425136,
      "mae_dy": 0.0027872552163898945,
      "pose_mae_dtheta": 0.05824314430356026,
      "pose_mae_dx": 0.024026628583669662,
      "pose_mae_dy": 0.023177750408649445,
      "pose_rmse_dtheta": 0.14381888508796692,
      "pose_rmse_dx": 0.06987272202968597,
      "pose_rmse_dy": 0.05910726264119148,
      "pose_rmse_mean": 0.09093295782804489,
      "rmse_dtheta": 0.020242419093847275,
      "rmse_dx": 0.0052865371108055115,
      "rmse_dy": 0.006248519755899906,
      "rmse_mean": 0.010592492297291756,
      "rotation_flip": 0.003325415775179863,
      "sparse_tokens": 32073.0,
      "step": 4445,
      "turn_loss": 0.08091995865106583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.20656011893700055,
      "grad_norm": 0.5243425369262695,
      "learning_rate": 7.071059586995806e-06,
      "loss": 0.1061,
      "mae_dtheta": 0.034797701984643936,
      "mae_dx": 0.011341224424540997,
      "mae_dy": 0.0025308895856142044,
      "pose_mae_dtheta": 0.28585758805274963,
      "pose_mae_dx": 0.10273199528455734,
      "pose_mae_dy": 0.02239500917494297,
      "pose_rmse_dtheta": 0.467810720205307,
      "pose_rmse_dx": 0.21391154825687408,
      "pose_rmse_dy": 0.06286514550447464,
      "pose_rmse_mean": 0.2481958121061325,
      "rmse_dtheta": 0.05178094655275345,
      "rmse_dx": 0.022608168423175812,
      "rmse_dy": 0.005602608434855938,
      "rmse_mean": 0.02666390687227249,
      "rotation_flip": 0.006956521887332201,
      "sparse_tokens": 8567.0,
      "step": 4446,
      "turn_loss": 0.25190290808677673,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.20660657870284332,
      "grad_norm": 1.2062203884124756,
      "learning_rate": 7.069856056565573e-06,
      "loss": 0.2258,
      "mae_dtheta": 0.03568559139966965,
      "mae_dx": 0.011952425353229046,
      "mae_dy": 0.003950757440179586,
      "pose_mae_dtheta": 0.27761638164520264,
      "pose_mae_dx": 0.09683375060558319,
      "pose_mae_dy": 0.051683589816093445,
      "pose_rmse_dtheta": 0.4929746389389038,
      "pose_rmse_dx": 0.23298263549804688,
      "pose_rmse_dy": 0.12088583409786224,
      "pose_rmse_mean": 0.2822810411453247,
      "rmse_dtheta": 0.05493347719311714,
      "rmse_dx": 0.02552657760679722,
      "rmse_dy": 0.008461722172796726,
      "rmse_mean": 0.029640592634677887,
      "rotation_flip": 0.015828678384423256,
      "sparse_tokens": 19454.0,
      "step": 4447,
      "turn_loss": 0.23091964423656464,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.20665303846868613,
      "grad_norm": 0.4453284740447998,
      "learning_rate": 7.0686523813891936e-06,
      "loss": 0.073,
      "mae_dtheta": 0.008512263186275959,
      "mae_dx": 0.0014195130206644535,
      "mae_dy": 0.0021117404103279114,
      "pose_mae_dtheta": 0.06140952929854393,
      "pose_mae_dx": 0.019414832815527916,
      "pose_mae_dy": 0.02642812393605709,
      "pose_rmse_dtheta": 0.18514259159564972,
      "pose_rmse_dx": 0.05653204023838043,
      "pose_rmse_dy": 0.07707317173480988,
      "pose_rmse_mean": 0.10624927282333374,
      "rmse_dtheta": 0.021595587953925133,
      "rmse_dx": 0.004300389904528856,
      "rmse_dy": 0.004892776254564524,
      "rmse_mean": 0.01026291772723198,
      "rotation_flip": 0.003757632803171873,
      "sparse_tokens": 32057.0,
      "step": 4448,
      "turn_loss": 0.06295519322156906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1017.0,
      "epoch": 0.2066994982345289,
      "grad_norm": 0.45256900787353516,
      "learning_rate": 7.067448561550844e-06,
      "loss": 0.1212,
      "mae_dtheta": 0.027666816487908363,
      "mae_dx": 0.01598062738776207,
      "mae_dy": 0.00648950319737196,
      "pose_mae_dtheta": 0.08152936398983002,
      "pose_mae_dx": 0.09010915458202362,
      "pose_mae_dy": 0.06049574539065361,
      "pose_rmse_dtheta": 0.10316181182861328,
      "pose_rmse_dx": 0.12947744131088257,
      "pose_rmse_dy": 0.08525043725967407,
      "pose_rmse_mean": 0.10596323013305664,
      "rmse_dtheta": 0.03482796624302864,
      "rmse_dx": 0.020636867731809616,
      "rmse_dy": 0.00959990918636322,
      "rmse_mean": 0.021688248962163925,
      "rotation_flip": 0.020408162847161293,
      "sparse_tokens": 925.0,
      "step": 4449,
      "turn_loss": 0.4467262327671051,
      "turns": 3.0,
      "turns_per_sample": 3.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.20674595800037168,
      "grad_norm": 0.3969787061214447,
      "learning_rate": 7.066244597134706e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.01037808321416378,
      "mae_dx": 0.0015761643880978227,
      "mae_dy": 0.002113847527652979,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3969787657260895,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.3736572265625,
      "model/head/act_norm_mean": 119.74260179924242,
      "model/head/act_norm_min": 63.93073654174805,
      "model/head/act_over_embed": 82.28823700433983,
      "model/head/grad_frac": 0.1219455748796463,
      "model/head/grad_norm": 0.048409804701805115,
      "model/head/grad_zero_frac": 0.00017862400272861123,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6965208727904041,
      "model/head/update_ratio": 0.0008306166273541749,
      "model/head/weight_delta": 7.8543267250061035,
      "model/head/weight_delta_rel": 0.13778816163539886,
      "model/head/weight_norm": 58.28176498413086,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4186173677444458,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41855641682942707,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4184854328632355,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28763588823209496,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09261961281299591,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03676801919937134,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5440277777777778,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011901886900886893,
      "model/modality_embedder.encoders.pose/weight_delta": 2.5785324573516846,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08424869179725647,
      "model/modality_embedder.encoders.pose/weight_norm": 30.892597198486328,
      "model/modality_embedder/grad_frac": 0.09261961281299591,
      "model/modality_embedder/grad_norm": 0.03676801919937134,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5440277777777778,
      "model/modality_embedder/update_ratio": 0.0011901886900886893,
      "model/modality_embedder/weight_delta": 2.5785324573516846,
      "model/modality_embedder/weight_delta_rel": 0.08424869179725647,
      "model/modality_embedder/weight_norm": 30.892597198486328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.15140533447266,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.49781796135963,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.09039306640625,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.835129855231596,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08333174884319305,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03308093547821045,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011909495806321502,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.8859459161758423,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06872500479221344,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.776939392089844,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.40876007080078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.5736206309123,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.200839042663574,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.574431521571466,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08920168876647949,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03541117534041405,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012017603730782866,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.3845672607421875,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08260327577590942,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.46608543395996,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.18212890625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.509123977873976,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.221297264099121,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.904527542071357,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09269476681947708,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03679785504937172,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012096669524908066,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.562354564666748,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08603906631469727,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.419824600219727,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.89485931396484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.284596961680293,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.535174369812012,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.12464919878302,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09978070855140686,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03961082175374031,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013329313369467854,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.187195062637329,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0747479498386383,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.71707534790039,
      "model/normalizer/grad_frac": 0.35097527503967285,
      "model/normalizer/grad_norm": 0.139329731464386,
      "model/normalizer/grad_zero_frac": 0.00015835295198485255,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017790623242035508,
      "model/normalizer/weight_delta": 4.644139766693115,
      "model/normalizer/weight_delta_rel": 0.05981383100152016,
      "model/normalizer/weight_norm": 78.3163833618164,
      "pose_mae_dtheta": 0.06768149137496948,
      "pose_mae_dx": 0.01969805359840393,
      "pose_mae_dy": 0.02603590302169323,
      "pose_rmse_dtheta": 0.18316513299942017,
      "pose_rmse_dx": 0.047578178346157074,
      "pose_rmse_dy": 0.054739341139793396,
      "pose_rmse_mean": 0.09516088664531708,
      "rmse_dtheta": 0.025081681087613106,
      "rmse_dx": 0.00455810222774744,
      "rmse_dy": 0.004331113304942846,
      "rmse_mean": 0.011323632672429085,
      "rotation_flip": 0.004125412553548813,
      "sparse_tokens": 32121.0,
      "step": 4450,
      "turn_loss": 0.08651755750179291,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20679241776621446,
      "grad_norm": 0.5506402254104614,
      "learning_rate": 7.065040488224975e-06,
      "loss": 0.2127,
      "mae_dtheta": 0.011026009917259216,
      "mae_dx": 0.0028873984701931477,
      "mae_dy": 0.003143747104331851,
      "pose_mae_dtheta": 0.07347994297742844,
      "pose_mae_dx": 0.024940865114331245,
      "pose_mae_dy": 0.03571923449635506,
      "pose_rmse_dtheta": 0.1586359441280365,
      "pose_rmse_dx": 0.0627400353550911,
      "pose_rmse_dy": 0.08050306886434555,
      "pose_rmse_mean": 0.10062634944915771,
      "rmse_dtheta": 0.023542562499642372,
      "rmse_dx": 0.009028608910739422,
      "rmse_dy": 0.007241559214890003,
      "rmse_mean": 0.013270909897983074,
      "rotation_flip": 0.004288777709007263,
      "sparse_tokens": 32089.0,
      "step": 4451,
      "turn_loss": 0.12454424053430557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.20683887753205724,
      "grad_norm": 0.4195989966392517,
      "learning_rate": 7.063836234905853e-06,
      "loss": 0.0964,
      "mae_dtheta": 0.008082597516477108,
      "mae_dx": 0.0017515469808131456,
      "mae_dy": 0.00207219528965652,
      "pose_mae_dtheta": 0.05629488453269005,
      "pose_mae_dx": 0.019772838801145554,
      "pose_mae_dy": 0.0180850587785244,
      "pose_rmse_dtheta": 0.2048218548297882,
      "pose_rmse_dx": 0.05860653147101402,
      "pose_rmse_dy": 0.05093029886484146,
      "pose_rmse_mean": 0.1047862321138382,
      "rmse_dtheta": 0.023979848250746727,
      "rmse_dx": 0.005240553990006447,
      "rmse_dy": 0.00683426670730114,
      "rmse_mean": 0.012018224224448204,
      "rotation_flip": 0.0069481562823057175,
      "sparse_tokens": 32105.0,
      "step": 4452,
      "turn_loss": 0.07367858290672302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2068853372979,
      "grad_norm": 0.5304531455039978,
      "learning_rate": 7.062631837261556e-06,
      "loss": 0.1182,
      "mae_dtheta": 0.010655430145561695,
      "mae_dx": 0.002190360566601157,
      "mae_dy": 0.002966497326269746,
      "pose_mae_dtheta": 0.07455562800168991,
      "pose_mae_dx": 0.02814199961721897,
      "pose_mae_dy": 0.029204586520791054,
      "pose_rmse_dtheta": 0.17901664972305298,
      "pose_rmse_dx": 0.0782303437590599,
      "pose_rmse_dy": 0.07574553042650223,
      "pose_rmse_mean": 0.1109975129365921,
      "rmse_dtheta": 0.0228747371584177,
      "rmse_dx": 0.006145551800727844,
      "rmse_dy": 0.007301856763660908,
      "rmse_mean": 0.012107382528483868,
      "rotation_flip": 0.0047846888191998005,
      "sparse_tokens": 32073.0,
      "step": 4453,
      "turn_loss": 0.09294280409812927,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2069317970637428,
      "grad_norm": 0.4520264267921448,
      "learning_rate": 7.061427295376308e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.011506951414048672,
      "mae_dx": 0.0018599372124299407,
      "mae_dy": 0.0025841412134468555,
      "pose_mae_dtheta": 0.07344846427440643,
      "pose_mae_dx": 0.026368524879217148,
      "pose_mae_dy": 0.02963988482952118,
      "pose_rmse_dtheta": 0.19288767874240875,
      "pose_rmse_dx": 0.07563702017068863,
      "pose_rmse_dy": 0.08126812428236008,
      "pose_rmse_mean": 0.11659761518239975,
      "rmse_dtheta": 0.025185544043779373,
      "rmse_dx": 0.005439169239252806,
      "rmse_dy": 0.006211183033883572,
      "rmse_mean": 0.012278633192181587,
      "rotation_flip": 0.0031250000465661287,
      "sparse_tokens": 32105.0,
      "step": 4454,
      "turn_loss": 0.10225810110569,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20697825682958557,
      "grad_norm": 0.5879040360450745,
      "learning_rate": 7.060222609334343e-06,
      "loss": 0.1524,
      "mae_dtheta": 0.012128561735153198,
      "mae_dx": 0.002122650621458888,
      "mae_dy": 0.003361316630616784,
      "pose_mae_dtheta": 0.09347580373287201,
      "pose_mae_dx": 0.03072368912398815,
      "pose_mae_dy": 0.03502625599503517,
      "pose_rmse_dtheta": 0.22515390813350677,
      "pose_rmse_dx": 0.0848204717040062,
      "pose_rmse_dy": 0.07608426362276077,
      "pose_rmse_mean": 0.12868621945381165,
      "rmse_dtheta": 0.02612319029867649,
      "rmse_dx": 0.005601883865892887,
      "rmse_dy": 0.007188097108155489,
      "rmse_mean": 0.012971057556569576,
      "rotation_flip": 0.0030651341658085585,
      "sparse_tokens": 32073.0,
      "step": 4455,
      "turn_loss": 0.0853503942489624,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20702471659542837,
      "grad_norm": 0.5622320175170898,
      "learning_rate": 7.059017779219904e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.011923032812774181,
      "mae_dx": 0.0017367246327921748,
      "mae_dy": 0.0032140810508280993,
      "pose_mae_dtheta": 0.08222825080156326,
      "pose_mae_dx": 0.029793143272399902,
      "pose_mae_dy": 0.03382905572652817,
      "pose_rmse_dtheta": 0.20082415640354156,
      "pose_rmse_dx": 0.07829998433589935,
      "pose_rmse_dy": 0.07640206813812256,
      "pose_rmse_mean": 0.11850874125957489,
      "rmse_dtheta": 0.024608664214611053,
      "rmse_dx": 0.004358184058219194,
      "rmse_dy": 0.006787818390876055,
      "rmse_mean": 0.011918222531676292,
      "rotation_flip": 0.0034494653809815645,
      "sparse_tokens": 32089.0,
      "step": 4456,
      "turn_loss": 0.0989205539226532,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.20707117636127115,
      "grad_norm": 0.5094312429428101,
      "learning_rate": 7.057812805117248e-06,
      "loss": 0.1223,
      "mae_dtheta": 0.011358795687556267,
      "mae_dx": 0.0018000239506363869,
      "mae_dy": 0.002589523559436202,
      "pose_mae_dtheta": 0.08309001475572586,
      "pose_mae_dx": 0.027932848781347275,
      "pose_mae_dy": 0.03015361912548542,
      "pose_rmse_dtheta": 0.19535501301288605,
      "pose_rmse_dx": 0.07212948054075241,
      "pose_rmse_dy": 0.07112916558980942,
      "pose_rmse_mean": 0.11287122219800949,
      "rmse_dtheta": 0.023120520636439323,
      "rmse_dx": 0.004477623384445906,
      "rmse_dy": 0.005563016515225172,
      "rmse_mean": 0.011053720489144325,
      "rotation_flip": 0.0022354694083333015,
      "sparse_tokens": 32137.0,
      "step": 4457,
      "turn_loss": 0.09536807984113693,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5532.0,
      "epoch": 0.20711763612711392,
      "grad_norm": 0.5764859318733215,
      "learning_rate": 7.056607687110637e-06,
      "loss": 0.1712,
      "mae_dtheta": 0.045942824333906174,
      "mae_dx": 0.02787463739514351,
      "mae_dy": 0.007269303780049086,
      "pose_mae_dtheta": 0.3629281520843506,
      "pose_mae_dx": 0.2141934633255005,
      "pose_mae_dy": 0.13029317557811737,
      "pose_rmse_dtheta": 0.6379584074020386,
      "pose_rmse_dx": 0.34952512383461,
      "pose_rmse_dy": 0.22028085589408875,
      "pose_rmse_mean": 0.4025881290435791,
      "rmse_dtheta": 0.0639500543475151,
      "rmse_dx": 0.04066763445734978,
      "rmse_dy": 0.011024748906493187,
      "rmse_mean": 0.03854747861623764,
      "rotation_flip": 0.017699114978313446,
      "sparse_tokens": 4434.0,
      "step": 4458,
      "turn_loss": 0.3615224361419678,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.2071640958929567,
      "grad_norm": 0.4666575789451599,
      "learning_rate": 7.055402425284346e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.03439824655652046,
      "mae_dx": 0.018575385212898254,
      "mae_dy": 0.0069023724645376205,
      "pose_mae_dtheta": 0.278738409280777,
      "pose_mae_dx": 0.1476726531982422,
      "pose_mae_dy": 0.09437926113605499,
      "pose_rmse_dtheta": 0.46685776114463806,
      "pose_rmse_dx": 0.3009357452392578,
      "pose_rmse_dy": 0.19582250714302063,
      "pose_rmse_mean": 0.32120534777641296,
      "rmse_dtheta": 0.05203128606081009,
      "rmse_dx": 0.03234750032424927,
      "rmse_dy": 0.013844065368175507,
      "rmse_mean": 0.03274095058441162,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 15732.0,
      "step": 4459,
      "turn_loss": 0.4007727801799774,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.20721055565879948,
      "grad_norm": 0.5192843675613403,
      "learning_rate": 7.05419701972266e-06,
      "loss": 0.1419,
      "mae_dtheta": 0.038168665021657944,
      "mae_dx": 0.013453107327222824,
      "mae_dy": 0.00970320962369442,
      "pose_mae_dtheta": 0.33404311537742615,
      "pose_mae_dx": 0.11921124160289764,
      "pose_mae_dy": 0.0851965844631195,
      "pose_rmse_dtheta": 0.5264904499053955,
      "pose_rmse_dx": 0.2579019069671631,
      "pose_rmse_dy": 0.19792282581329346,
      "pose_rmse_mean": 0.3274384140968323,
      "rmse_dtheta": 0.05415543168783188,
      "rmse_dx": 0.024848472326993942,
      "rmse_dy": 0.01987970992922783,
      "rmse_mean": 0.03296120464801788,
      "rotation_flip": 0.014557670801877975,
      "sparse_tokens": 14692.0,
      "step": 4460,
      "turn_loss": 0.3398185074329376,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.20725701542464225,
      "grad_norm": 0.4885231554508209,
      "learning_rate": 7.0529914705098755e-06,
      "loss": 0.1101,
      "mae_dtheta": 0.010364502668380737,
      "mae_dx": 0.0018986053764820099,
      "mae_dy": 0.0022857545409351587,
      "pose_mae_dtheta": 0.07269737124443054,
      "pose_mae_dx": 0.023944484069943428,
      "pose_mae_dy": 0.02887854352593422,
      "pose_rmse_dtheta": 0.15557993948459625,
      "pose_rmse_dx": 0.06576424092054367,
      "pose_rmse_dy": 0.07038136571645737,
      "pose_rmse_mean": 0.0972418487071991,
      "rmse_dtheta": 0.02053353749215603,
      "rmse_dx": 0.006106141023337841,
      "rmse_dy": 0.00519008981063962,
      "rmse_mean": 0.010609922930598259,
      "rotation_flip": 0.006533279083669186,
      "sparse_tokens": 32121.0,
      "step": 4461,
      "turn_loss": 0.08815861493349075,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.20730347519048503,
      "grad_norm": 0.3734058737754822,
      "learning_rate": 7.051785777730295e-06,
      "loss": 0.1024,
      "mae_dtheta": 0.03402535989880562,
      "mae_dx": 0.01575346849858761,
      "mae_dy": 0.004365732427686453,
      "pose_mae_dtheta": 0.2819441258907318,
      "pose_mae_dx": 0.12940344214439392,
      "pose_mae_dy": 0.05962473526597023,
      "pose_rmse_dtheta": 0.4615571200847626,
      "pose_rmse_dx": 0.2662621736526489,
      "pose_rmse_dy": 0.14382296800613403,
      "pose_rmse_mean": 0.2905474305152893,
      "rmse_dtheta": 0.05158994719386101,
      "rmse_dx": 0.02901550382375717,
      "rmse_dy": 0.00969344936311245,
      "rmse_mean": 0.03009963408112526,
      "rotation_flip": 0.01056338008493185,
      "sparse_tokens": 14672.0,
      "step": 4462,
      "turn_loss": 0.26548415422439575,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2073499349563278,
      "grad_norm": 0.37208932638168335,
      "learning_rate": 7.050579941468234e-06,
      "loss": 0.0741,
      "mae_dtheta": 0.008630672469735146,
      "mae_dx": 0.0011980688432231545,
      "mae_dy": 0.0012598274042829871,
      "pose_mae_dtheta": 0.06023019552230835,
      "pose_mae_dx": 0.01570482924580574,
      "pose_mae_dy": 0.019786255434155464,
      "pose_rmse_dtheta": 0.17701731622219086,
      "pose_rmse_dx": 0.04164479672908783,
      "pose_rmse_dy": 0.05271897092461586,
      "pose_rmse_mean": 0.09046036005020142,
      "rmse_dtheta": 0.022459110245108604,
      "rmse_dx": 0.004244398325681686,
      "rmse_dy": 0.00305648404173553,
      "rmse_mean": 0.009919997304677963,
      "rotation_flip": 0.0033802816178649664,
      "sparse_tokens": 32073.0,
      "step": 4463,
      "turn_loss": 0.054991770535707474,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.2073963947221706,
      "grad_norm": 0.4412338435649872,
      "learning_rate": 7.0493739618080174e-06,
      "loss": 0.0994,
      "mae_dtheta": 0.02569013275206089,
      "mae_dx": 0.011458832770586014,
      "mae_dy": 0.0031424432527273893,
      "pose_mae_dtheta": 0.21049220860004425,
      "pose_mae_dx": 0.07765772193670273,
      "pose_mae_dy": 0.03992979973554611,
      "pose_rmse_dtheta": 0.43716129660606384,
      "pose_rmse_dx": 0.1955103576183319,
      "pose_rmse_dy": 0.09609227627515793,
      "pose_rmse_mean": 0.24292132258415222,
      "rmse_dtheta": 0.04599515721201897,
      "rmse_dx": 0.024166960269212723,
      "rmse_dy": 0.007212394382804632,
      "rmse_mean": 0.025791503489017487,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 12073.0,
      "step": 4464,
      "turn_loss": 0.17025718092918396,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.2074428544880134,
      "grad_norm": 0.511555016040802,
      "learning_rate": 7.048167838833977e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.04065779969096184,
      "mae_dx": 0.012924383394420147,
      "mae_dy": 0.005690920166671276,
      "pose_mae_dtheta": 0.30941951274871826,
      "pose_mae_dx": 0.08399951457977295,
      "pose_mae_dy": 0.07753510028123856,
      "pose_rmse_dtheta": 0.6038193702697754,
      "pose_rmse_dx": 0.1999872773885727,
      "pose_rmse_dy": 0.1727086454629898,
      "pose_rmse_mean": 0.3255051076412201,
      "rmse_dtheta": 0.061195891350507736,
      "rmse_dx": 0.02607535757124424,
      "rmse_dy": 0.010224209167063236,
      "rmse_mean": 0.03249848634004593,
      "rotation_flip": 0.0035714285913854837,
      "sparse_tokens": 4731.0,
      "step": 4465,
      "turn_loss": 0.20389464497566223,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.20748931425385617,
      "grad_norm": 0.4444532096385956,
      "learning_rate": 7.046961572630463e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.011090227402746677,
      "mae_dx": 0.001789630507119,
      "mae_dy": 0.003143866313621402,
      "pose_mae_dtheta": 0.07167857140302658,
      "pose_mae_dx": 0.029008256271481514,
      "pose_mae_dy": 0.034568335860967636,
      "pose_rmse_dtheta": 0.14197129011154175,
      "pose_rmse_dx": 0.07026723772287369,
      "pose_rmse_dy": 0.07542496919631958,
      "pose_rmse_mean": 0.09588783234357834,
      "rmse_dtheta": 0.021369460970163345,
      "rmse_dx": 0.004397794604301453,
      "rmse_dy": 0.00657831784337759,
      "rmse_mean": 0.010781858116388321,
      "rotation_flip": 0.003014065558090806,
      "sparse_tokens": 32121.0,
      "step": 4466,
      "turn_loss": 0.09546934068202972,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.20753577401969894,
      "grad_norm": 0.4915003180503845,
      "learning_rate": 7.045755163281827e-06,
      "loss": 0.1428,
      "mae_dtheta": 0.03741070628166199,
      "mae_dx": 0.0146077461540699,
      "mae_dy": 0.004379322286695242,
      "pose_mae_dtheta": 0.29645419120788574,
      "pose_mae_dx": 0.11292500048875809,
      "pose_mae_dy": 0.052016351372003555,
      "pose_rmse_dtheta": 0.5204591155052185,
      "pose_rmse_dx": 0.24870853126049042,
      "pose_rmse_dy": 0.1136704608798027,
      "pose_rmse_mean": 0.29427939653396606,
      "rmse_dtheta": 0.05666405335068703,
      "rmse_dx": 0.02770715393126011,
      "rmse_dy": 0.008414112962782383,
      "rmse_mean": 0.030928440392017365,
      "rotation_flip": 0.010628019459545612,
      "sparse_tokens": 20175.0,
      "step": 4467,
      "turn_loss": 0.27719032764434814,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 34282.0,
      "epoch": 0.20758223378554172,
      "grad_norm": 0.4188361167907715,
      "learning_rate": 7.044548610872435e-06,
      "loss": 0.1164,
      "mae_dtheta": 0.037541892379522324,
      "mae_dx": 0.014522789977490902,
      "mae_dy": 0.004530624952167273,
      "pose_mae_dtheta": 0.31576797366142273,
      "pose_mae_dx": 0.11497839540243149,
      "pose_mae_dy": 0.06502218544483185,
      "pose_rmse_dtheta": 0.5394834876060486,
      "pose_rmse_dx": 0.2545711100101471,
      "pose_rmse_dy": 0.14839905500411987,
      "pose_rmse_mean": 0.31415122747421265,
      "rmse_dtheta": 0.05586737021803856,
      "rmse_dx": 0.02821081504225731,
      "rmse_dy": 0.01002794224768877,
      "rmse_mean": 0.03136871010065079,
      "rotation_flip": 0.0074165635742247105,
      "sparse_tokens": 27004.0,
      "step": 4468,
      "turn_loss": 0.24930192530155182,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2076286935513845,
      "grad_norm": 0.44840338826179504,
      "learning_rate": 7.04334191548666e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.012380371801555157,
      "mae_dx": 0.0025351657532155514,
      "mae_dy": 0.002342008287087083,
      "pose_mae_dtheta": 0.08919453620910645,
      "pose_mae_dx": 0.02391851507127285,
      "pose_mae_dy": 0.027923498302698135,
      "pose_rmse_dtheta": 0.2350420355796814,
      "pose_rmse_dx": 0.06746117025613785,
      "pose_rmse_dy": 0.06449747830629349,
      "pose_rmse_mean": 0.12233355641365051,
      "rmse_dtheta": 0.028012696653604507,
      "rmse_dx": 0.007925068028271198,
      "rmse_dy": 0.005823604296892881,
      "rmse_mean": 0.013920456171035767,
      "rotation_flip": 0.0058035715483129025,
      "sparse_tokens": 32121.0,
      "step": 4469,
      "turn_loss": 0.10110579431056976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.20767515331722727,
      "grad_norm": 0.707166850566864,
      "learning_rate": 7.042135077208889e-06,
      "loss": 0.2015,
      "mae_dtheta": 0.02840391732752323,
      "mae_dx": 0.010443399660289288,
      "mae_dy": 0.005889381747692823,
      "pose_mae_dtheta": 0.2349085956811905,
      "pose_mae_dx": 0.07357382774353027,
      "pose_mae_dy": 0.056072577834129333,
      "pose_rmse_dtheta": 0.4256192743778229,
      "pose_rmse_dx": 0.14696411788463593,
      "pose_rmse_dy": 0.13741697371006012,
      "pose_rmse_mean": 0.23666678369045258,
      "rmse_dtheta": 0.046350110322237015,
      "rmse_dx": 0.021738484501838684,
      "rmse_dy": 0.012649999000132084,
      "rmse_mean": 0.026912864297628403,
      "rotation_flip": 0.002364066196605563,
      "sparse_tokens": 7692.0,
      "step": 4470,
      "turn_loss": 0.335362046957016,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.20772161308307005,
      "grad_norm": 0.4637276232242584,
      "learning_rate": 7.040928096123516e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.025626961141824722,
      "mae_dx": 0.006893220357596874,
      "mae_dy": 0.004098854027688503,
      "pose_mae_dtheta": 0.21117807924747467,
      "pose_mae_dx": 0.06391844153404236,
      "pose_mae_dy": 0.042525455355644226,
      "pose_rmse_dtheta": 0.3539122939109802,
      "pose_rmse_dx": 0.13185156881809235,
      "pose_rmse_dy": 0.10190604627132416,
      "pose_rmse_mean": 0.19588997960090637,
      "rmse_dtheta": 0.04042408987879753,
      "rmse_dx": 0.01573159545660019,
      "rmse_dy": 0.008493827655911446,
      "rmse_mean": 0.02154983952641487,
      "rotation_flip": 0.01565217413008213,
      "sparse_tokens": 9638.0,
      "step": 4471,
      "turn_loss": 0.21560092270374298,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 36338.0,
      "epoch": 0.20776807284891285,
      "grad_norm": 0.6786888837814331,
      "learning_rate": 7.0397209723149455e-06,
      "loss": 0.1956,
      "mae_dtheta": 0.03789941966533661,
      "mae_dx": 0.011886530555784702,
      "mae_dy": 0.005442668683826923,
      "pose_mae_dtheta": 0.2744012176990509,
      "pose_mae_dx": 0.08869283646345139,
      "pose_mae_dy": 0.060448456555604935,
      "pose_rmse_dtheta": 0.46386221051216125,
      "pose_rmse_dx": 0.20361272990703583,
      "pose_rmse_dy": 0.1401480883359909,
      "pose_rmse_mean": 0.2692076861858368,
      "rmse_dtheta": 0.055504802614450455,
      "rmse_dx": 0.02377268858253956,
      "rmse_dy": 0.011975284665822983,
      "rmse_mean": 0.030417591333389282,
      "rotation_flip": 0.011723329313099384,
      "sparse_tokens": 28615.0,
      "step": 4472,
      "turn_loss": 0.3111779987812042,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20781453261475563,
      "grad_norm": 0.43202272057533264,
      "learning_rate": 7.038513705867593e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.011141682974994183,
      "mae_dx": 0.0024591353721916676,
      "mae_dy": 0.0030244183726608753,
      "pose_mae_dtheta": 0.08419545739889145,
      "pose_mae_dx": 0.02117595262825489,
      "pose_mae_dy": 0.029463455080986023,
      "pose_rmse_dtheta": 0.22590811550617218,
      "pose_rmse_dx": 0.06054696813225746,
      "pose_rmse_dy": 0.06789367645978928,
      "pose_rmse_mean": 0.11811625957489014,
      "rmse_dtheta": 0.02657519467175007,
      "rmse_dx": 0.008840383030474186,
      "rmse_dy": 0.008359161205589771,
      "rmse_mean": 0.014591580256819725,
      "rotation_flip": 0.005824372638016939,
      "sparse_tokens": 32073.0,
      "step": 4473,
      "turn_loss": 0.09831877797842026,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2078609923805984,
      "grad_norm": 0.5143328905105591,
      "learning_rate": 7.037306296865882e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.010477491654455662,
      "mae_dx": 0.003274221671745181,
      "mae_dy": 0.0018989196978509426,
      "pose_mae_dtheta": 0.08824218809604645,
      "pose_mae_dx": 0.02651187591254711,
      "pose_mae_dy": 0.029742497950792313,
      "pose_rmse_dtheta": 0.22078505158424377,
      "pose_rmse_dx": 0.08810299634933472,
      "pose_rmse_dy": 0.07557308673858643,
      "pose_rmse_mean": 0.1281537115573883,
      "rmse_dtheta": 0.024370567873120308,
      "rmse_dx": 0.011761125177145004,
      "rmse_dy": 0.004753415938466787,
      "rmse_mean": 0.013628370128571987,
      "rotation_flip": 0.004081632476300001,
      "sparse_tokens": 32041.0,
      "step": 4474,
      "turn_loss": 0.09941945970058441,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20790745214644119,
      "grad_norm": 0.578497588634491,
      "learning_rate": 7.036098745394248e-06,
      "loss": 0.153,
      "mae_dtheta": 0.01946081966161728,
      "mae_dx": 0.009784592315554619,
      "mae_dy": 0.007481529843062162,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5784975290298462,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.96340942382812,
      "model/head/act_norm_mean": 98.76827848800505,
      "model/head/act_norm_min": 44.6928596496582,
      "model/head/act_over_embed": 67.87448566014889,
      "model/head/grad_frac": 0.09991061687469482,
      "model/head/grad_norm": 0.05779804289340973,
      "model/head/grad_zero_frac": 0.0001932185114128515,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7001065340909091,
      "model/head/update_ratio": 0.000991620123386383,
      "model/head/weight_delta": 7.874209880828857,
      "model/head/weight_delta_rel": 0.13813696801662445,
      "model/head/weight_norm": 58.286476135253906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41870710253715515,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4186391355764812,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4185716211795807,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2876927333294957,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09721915423870087,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05624103918671608,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5479973840497737,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001820470322854817,
      "model/modality_embedder.encoders.pose/weight_delta": 2.5801355838775635,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08430106937885284,
      "model/modality_embedder.encoders.pose/weight_norm": 30.893686294555664,
      "model/modality_embedder/grad_frac": 0.09721915423870087,
      "model/modality_embedder/grad_norm": 0.05624103918671608,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5479973840497737,
      "model/modality_embedder/update_ratio": 0.001820470322854817,
      "model/modality_embedder/weight_delta": 2.5801355838775635,
      "model/modality_embedder/weight_delta_rel": 0.08430106937885284,
      "model/modality_embedder/weight_norm": 30.893686294555664,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.91337585449219,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.55163991101491,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.034720420837402,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.497698078628728,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06230107322335243,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0360410176217556,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012974507408216596,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.8935019969940186,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06900035589933395,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.778331756591797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.40534973144531,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.485792949334616,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.35421371459961,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.139656792240565,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06422007083892822,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03715115040540695,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012606971431523561,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.393803358078003,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08292321860790253,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.468734741210938,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.66865539550781,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.341778399070066,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.630908012390137,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.41510736930831,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07363752275705338,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04259912669658661,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014002724783495069,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.572239875793457,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08637099713087082,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.422027587890625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.48932647705078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.35509108946609,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.580949783325195,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.798674699078834,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07801973074674606,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04513422027230263,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015186923556029797,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.1958987712860107,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0750453993678093,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.719133377075195,
      "model/normalizer/grad_frac": 0.2710544764995575,
      "model/normalizer/grad_norm": 0.15680433809757233,
      "model/normalizer/grad_zero_frac": 0.00022216682555153966,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002002117922529578,
      "model/normalizer/weight_delta": 4.662339210510254,
      "model/normalizer/weight_delta_rel": 0.06004822999238968,
      "model/normalizer/weight_norm": 78.31922912597656,
      "pose_mae_dtheta": 0.14354673027992249,
      "pose_mae_dx": 0.09693865478038788,
      "pose_mae_dy": 0.06816044449806213,
      "pose_rmse_dtheta": 0.2903643250465393,
      "pose_rmse_dx": 0.21354733407497406,
      "pose_rmse_dy": 0.1426079124212265,
      "pose_rmse_mean": 0.21550653874874115,
      "rmse_dtheta": 0.03407500311732292,
      "rmse_dx": 0.020793171599507332,
      "rmse_dy": 0.01417260430753231,
      "rmse_mean": 0.02301359549164772,
      "rotation_flip": 0.008947744965553284,
      "sparse_tokens": 32089.0,
      "step": 4475,
      "turn_loss": 0.27452412247657776,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.20795391191228396,
      "grad_norm": 0.6754724979400635,
      "learning_rate": 7.0348910515371375e-06,
      "loss": 0.214,
      "mae_dtheta": 0.012349079363048077,
      "mae_dx": 0.002255894709378481,
      "mae_dy": 0.002068568952381611,
      "pose_mae_dtheta": 0.08603975176811218,
      "pose_mae_dx": 0.02311391942203045,
      "pose_mae_dy": 0.026782570406794548,
      "pose_rmse_dtheta": 0.2151515781879425,
      "pose_rmse_dx": 0.05049809068441391,
      "pose_rmse_dy": 0.0575074777007103,
      "pose_rmse_mean": 0.1077190563082695,
      "rmse_dtheta": 0.027513347566127777,
      "rmse_dx": 0.006131495349109173,
      "rmse_dy": 0.00444355234503746,
      "rmse_mean": 0.012696132063865662,
      "rotation_flip": 0.004501125309616327,
      "sparse_tokens": 32153.0,
      "step": 4476,
      "turn_loss": 0.1029144749045372,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.20800037167812674,
      "grad_norm": 1.0688267946243286,
      "learning_rate": 7.033683215379002e-06,
      "loss": 0.2591,
      "mae_dtheta": 0.051148757338523865,
      "mae_dx": 0.010517846792936325,
      "mae_dy": 0.009399838745594025,
      "pose_mae_dtheta": 0.3592059016227722,
      "pose_mae_dx": 0.06330250203609467,
      "pose_mae_dy": 0.118198461830616,
      "pose_rmse_dtheta": 0.5682185292243958,
      "pose_rmse_dx": 0.18311481177806854,
      "pose_rmse_dy": 0.25019940733909607,
      "pose_rmse_mean": 0.33384427428245544,
      "rmse_dtheta": 0.06905873119831085,
      "rmse_dx": 0.023051638156175613,
      "rmse_dy": 0.016362417489290237,
      "rmse_mean": 0.03615759313106537,
      "rotation_flip": 0.019455252215266228,
      "sparse_tokens": 4038.0,
      "step": 4477,
      "turn_loss": 0.3933528661727905,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.20804683144396952,
      "grad_norm": 0.4513028860092163,
      "learning_rate": 7.032475237004308e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.02552933245897293,
      "mae_dx": 0.011354845948517323,
      "mae_dy": 0.006314617581665516,
      "pose_mae_dtheta": 0.20056982338428497,
      "pose_mae_dx": 0.10531320422887802,
      "pose_mae_dy": 0.07982096076011658,
      "pose_rmse_dtheta": 0.3789782226085663,
      "pose_rmse_dx": 0.24673275649547577,
      "pose_rmse_dy": 0.17803703248500824,
      "pose_rmse_mean": 0.2679160237312317,
      "rmse_dtheta": 0.042555078864097595,
      "rmse_dx": 0.025244109332561493,
      "rmse_dy": 0.012650511227548122,
      "rmse_mean": 0.02681656740605831,
      "rotation_flip": 0.01706484705209732,
      "sparse_tokens": 13054.0,
      "step": 4478,
      "turn_loss": 0.26526907086372375,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.2080932912098123,
      "grad_norm": 0.4118117690086365,
      "learning_rate": 7.03126711649753e-06,
      "loss": 0.1093,
      "mae_dtheta": 0.035807620733976364,
      "mae_dx": 0.013224448077380657,
      "mae_dy": 0.005792588926851749,
      "pose_mae_dtheta": 0.2898964583873749,
      "pose_mae_dx": 0.09755725413560867,
      "pose_mae_dy": 0.0636652335524559,
      "pose_rmse_dtheta": 0.5148873329162598,
      "pose_rmse_dx": 0.21767151355743408,
      "pose_rmse_dy": 0.139346644282341,
      "pose_rmse_mean": 0.2906351685523987,
      "rmse_dtheta": 0.05339125171303749,
      "rmse_dx": 0.0265821423381567,
      "rmse_dy": 0.011334032751619816,
      "rmse_mean": 0.03043580800294876,
      "rotation_flip": 0.011437908746302128,
      "sparse_tokens": 18815.0,
      "step": 4479,
      "turn_loss": 0.3021990656852722,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.20813975097565507,
      "grad_norm": 0.3944982588291168,
      "learning_rate": 7.030058853943152e-06,
      "loss": 0.1,
      "mae_dtheta": 0.010061545297503471,
      "mae_dx": 0.0019367632921785116,
      "mae_dy": 0.0020956024527549744,
      "pose_mae_dtheta": 0.06928209215402603,
      "pose_mae_dx": 0.023873185738921165,
      "pose_mae_dy": 0.026207173243165016,
      "pose_rmse_dtheta": 0.15698081254959106,
      "pose_rmse_dx": 0.0598091185092926,
      "pose_rmse_dy": 0.06564915180206299,
      "pose_rmse_mean": 0.09414636343717575,
      "rmse_dtheta": 0.020909450948238373,
      "rmse_dx": 0.005380596965551376,
      "rmse_dy": 0.004690512549132109,
      "rmse_mean": 0.010326853953301907,
      "rotation_flip": 0.003924646880477667,
      "sparse_tokens": 32137.0,
      "step": 4480,
      "turn_loss": 0.0885322168469429,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.20818621074149787,
      "grad_norm": 0.4865524470806122,
      "learning_rate": 7.02885044942567e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.006292147096246481,
      "mae_dx": 0.0013020153855904937,
      "mae_dy": 0.001395509927533567,
      "pose_mae_dtheta": 0.043345287442207336,
      "pose_mae_dx": 0.015369700267910957,
      "pose_mae_dy": 0.01752910390496254,
      "pose_rmse_dtheta": 0.10696443915367126,
      "pose_rmse_dx": 0.044562928378582,
      "pose_rmse_dy": 0.04227542504668236,
      "pose_rmse_mean": 0.06460093706846237,
      "rmse_dtheta": 0.014311078004539013,
      "rmse_dx": 0.004210422746837139,
      "rmse_dy": 0.0035483110696077347,
      "rmse_mean": 0.007356604095548391,
      "rotation_flip": 0.005169442854821682,
      "sparse_tokens": 32057.0,
      "step": 4481,
      "turn_loss": 0.05068245157599449,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28139.0,
      "epoch": 0.20823267050734065,
      "grad_norm": 0.9433713555335999,
      "learning_rate": 7.027641903029586e-06,
      "loss": 0.2381,
      "mae_dtheta": 0.03723255544900894,
      "mae_dx": 0.01108334120362997,
      "mae_dy": 0.0028005773201584816,
      "pose_mae_dtheta": 0.2941058874130249,
      "pose_mae_dx": 0.08780347555875778,
      "pose_mae_dy": 0.03143801540136337,
      "pose_rmse_dtheta": 0.5257209539413452,
      "pose_rmse_dx": 0.20926319062709808,
      "pose_rmse_dy": 0.0768134593963623,
      "pose_rmse_mean": 0.27059921622276306,
      "rmse_dtheta": 0.05617943033576012,
      "rmse_dx": 0.023561270907521248,
      "rmse_dy": 0.006213140208274126,
      "rmse_mean": 0.02865128219127655,
      "rotation_flip": 0.009404388256371021,
      "sparse_tokens": 22709.0,
      "step": 4482,
      "turn_loss": 0.2517716884613037,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.20827913027318343,
      "grad_norm": 0.44522571563720703,
      "learning_rate": 7.026433214839416e-06,
      "loss": 0.0816,
      "mae_dtheta": 0.012923778034746647,
      "mae_dx": 0.002343824366107583,
      "mae_dy": 0.0038248945493251085,
      "pose_mae_dtheta": 0.08772918581962585,
      "pose_mae_dx": 0.03169434517621994,
      "pose_mae_dy": 0.0423467643558979,
      "pose_rmse_dtheta": 0.17005082964897156,
      "pose_rmse_dx": 0.07251354306936264,
      "pose_rmse_dy": 0.10747597366571426,
      "pose_rmse_mean": 0.11668011546134949,
      "rmse_dtheta": 0.023233069106936455,
      "rmse_dx": 0.006723927799612284,
      "rmse_dy": 0.008113975636661053,
      "rmse_mean": 0.01269032433629036,
      "rotation_flip": 0.008020532317459583,
      "sparse_tokens": 32105.0,
      "step": 4483,
      "turn_loss": 0.1068829596042633,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2083255900390262,
      "grad_norm": 0.4469686448574066,
      "learning_rate": 7.025224384939682e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.011057236231863499,
      "mae_dx": 0.001843818579800427,
      "mae_dy": 0.0021318914368748665,
      "pose_mae_dtheta": 0.07942609488964081,
      "pose_mae_dx": 0.02579999528825283,
      "pose_mae_dy": 0.030832892283797264,
      "pose_rmse_dtheta": 0.2133604884147644,
      "pose_rmse_dx": 0.07533280551433563,
      "pose_rmse_dy": 0.08431743085384369,
      "pose_rmse_mean": 0.12433692067861557,
      "rmse_dtheta": 0.02481665275990963,
      "rmse_dx": 0.005778521299362183,
      "rmse_dy": 0.005090530030429363,
      "rmse_mean": 0.011895234696567059,
      "rotation_flip": 0.00663129985332489,
      "sparse_tokens": 32073.0,
      "step": 4484,
      "turn_loss": 0.08714119344949722,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.20837204980486898,
      "grad_norm": 0.6280767917633057,
      "learning_rate": 7.0240154134149215e-06,
      "loss": 0.145,
      "mae_dtheta": 0.027041420340538025,
      "mae_dx": 0.009729591198265553,
      "mae_dy": 0.0038745722267776728,
      "pose_mae_dtheta": 0.19102345407009125,
      "pose_mae_dx": 0.08336878567934036,
      "pose_mae_dy": 0.04107573255896568,
      "pose_rmse_dtheta": 0.3498079478740692,
      "pose_rmse_dx": 0.21851223707199097,
      "pose_rmse_dy": 0.10250461846590042,
      "pose_rmse_mean": 0.22360825538635254,
      "rmse_dtheta": 0.04264875501394272,
      "rmse_dx": 0.022843796759843826,
      "rmse_dy": 0.008008289150893688,
      "rmse_mean": 0.024500280618667603,
      "rotation_flip": 0.01750972680747509,
      "sparse_tokens": 9949.0,
      "step": 4485,
      "turn_loss": 0.17860089242458344,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.20841850957071176,
      "grad_norm": 0.7175711393356323,
      "learning_rate": 7.022806300349676e-06,
      "loss": 0.1968,
      "mae_dtheta": 0.039619915187358856,
      "mae_dx": 0.011401821859180927,
      "mae_dy": 0.003686656942591071,
      "pose_mae_dtheta": 0.3587358891963959,
      "pose_mae_dx": 0.08913818746805191,
      "pose_mae_dy": 0.03675108775496483,
      "pose_rmse_dtheta": 0.5986900925636292,
      "pose_rmse_dx": 0.206206277012825,
      "pose_rmse_dy": 0.09084974974393845,
      "pose_rmse_mean": 0.2985820472240448,
      "rmse_dtheta": 0.059856437146663666,
      "rmse_dx": 0.022914228960871696,
      "rmse_dy": 0.009168034419417381,
      "rmse_mean": 0.03064623475074768,
      "rotation_flip": 0.01946246437728405,
      "sparse_tokens": 17136.0,
      "step": 4486,
      "turn_loss": 0.3096153736114502,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 32015.0,
      "epoch": 0.20846496933655453,
      "grad_norm": 0.9501710534095764,
      "learning_rate": 7.021597045828501e-06,
      "loss": 0.2308,
      "mae_dtheta": 0.03826079145073891,
      "mae_dx": 0.014905313961207867,
      "mae_dy": 0.007652592845261097,
      "pose_mae_dtheta": 0.32083895802497864,
      "pose_mae_dx": 0.11511971801519394,
      "pose_mae_dy": 0.08826546370983124,
      "pose_rmse_dtheta": 0.5475847721099854,
      "pose_rmse_dx": 0.24626263976097107,
      "pose_rmse_dy": 0.21981514990329742,
      "pose_rmse_mean": 0.3378875255584717,
      "rmse_dtheta": 0.05651681125164032,
      "rmse_dx": 0.028344901278614998,
      "rmse_dy": 0.016728641465306282,
      "rmse_mean": 0.03386345133185387,
      "rotation_flip": 0.013477088883519173,
      "sparse_tokens": 25429.0,
      "step": 4487,
      "turn_loss": 0.3396528959274292,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.2085114291023973,
      "grad_norm": 0.5314525961875916,
      "learning_rate": 7.020387649935959e-06,
      "loss": 0.2252,
      "mae_dtheta": 0.047837406396865845,
      "mae_dx": 0.01567181386053562,
      "mae_dy": 0.007159506902098656,
      "pose_mae_dtheta": 0.40136057138442993,
      "pose_mae_dx": 0.12587225437164307,
      "pose_mae_dy": 0.06973472982645035,
      "pose_rmse_dtheta": 0.6078159213066101,
      "pose_rmse_dx": 0.25587424635887146,
      "pose_rmse_dy": 0.18780750036239624,
      "pose_rmse_mean": 0.3504992425441742,
      "rmse_dtheta": 0.06306514889001846,
      "rmse_dx": 0.028788065537810326,
      "rmse_dy": 0.017126809805631638,
      "rmse_mean": 0.03632667660713196,
      "rotation_flip": 0.019940178841352463,
      "sparse_tokens": 14461.0,
      "step": 4488,
      "turn_loss": 0.42880216240882874,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.20855788886824012,
      "grad_norm": 0.4695422053337097,
      "learning_rate": 7.019178112756625e-06,
      "loss": 0.1294,
      "mae_dtheta": 0.009445873089134693,
      "mae_dx": 0.002338308608159423,
      "mae_dy": 0.0026090415194630623,
      "pose_mae_dtheta": 0.06637955456972122,
      "pose_mae_dx": 0.027401117607951164,
      "pose_mae_dy": 0.025608116760849953,
      "pose_rmse_dtheta": 0.19174091517925262,
      "pose_rmse_dx": 0.07312570512294769,
      "pose_rmse_dy": 0.06572464853525162,
      "pose_rmse_mean": 0.11019708961248398,
      "rmse_dtheta": 0.022031811997294426,
      "rmse_dx": 0.006249288097023964,
      "rmse_dy": 0.006382524035871029,
      "rmse_mean": 0.011554541997611523,
      "rotation_flip": 0.004486133810132742,
      "sparse_tokens": 32105.0,
      "step": 4489,
      "turn_loss": 0.07870148867368698,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2086043486340829,
      "grad_norm": 0.45902019739151,
      "learning_rate": 7.017968434375081e-06,
      "loss": 0.0983,
      "mae_dtheta": 0.011027852073311806,
      "mae_dx": 0.002433381276205182,
      "mae_dy": 0.002675461582839489,
      "pose_mae_dtheta": 0.07513710111379623,
      "pose_mae_dx": 0.026409264653921127,
      "pose_mae_dy": 0.028030846267938614,
      "pose_rmse_dtheta": 0.1823839545249939,
      "pose_rmse_dx": 0.06580799072980881,
      "pose_rmse_dy": 0.06280626356601715,
      "pose_rmse_mean": 0.10366606712341309,
      "rmse_dtheta": 0.023324064910411835,
      "rmse_dx": 0.0075640748254954815,
      "rmse_dy": 0.006595135200768709,
      "rmse_mean": 0.012494425289332867,
      "rotation_flip": 0.006631762720644474,
      "sparse_tokens": 32169.0,
      "step": 4490,
      "turn_loss": 0.0960119441151619,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20865080839992567,
      "grad_norm": 0.5505945086479187,
      "learning_rate": 7.016758614875921e-06,
      "loss": 0.0769,
      "mae_dtheta": 0.00776683958247304,
      "mae_dx": 0.004938275087624788,
      "mae_dy": 0.0012002978473901749,
      "pose_mae_dtheta": 0.05915502458810806,
      "pose_mae_dx": 0.03947770968079567,
      "pose_mae_dy": 0.01904359832406044,
      "pose_rmse_dtheta": 0.18887412548065186,
      "pose_rmse_dx": 0.13997575640678406,
      "pose_rmse_dy": 0.06260374933481216,
      "pose_rmse_mean": 0.13048455119132996,
      "rmse_dtheta": 0.021566838026046753,
      "rmse_dx": 0.015092482790350914,
      "rmse_dy": 0.00400972506031394,
      "rmse_mean": 0.013556349091231823,
      "rotation_flip": 0.0019083969527855515,
      "sparse_tokens": 32089.0,
      "step": 4491,
      "turn_loss": 0.07024665921926498,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.20869726816576845,
      "grad_norm": 0.5058781504631042,
      "learning_rate": 7.015548654343749e-06,
      "loss": 0.1722,
      "mae_dtheta": 0.00957842543721199,
      "mae_dx": 0.002269627060741186,
      "mae_dy": 0.002222650218755007,
      "pose_mae_dtheta": 0.06453227996826172,
      "pose_mae_dx": 0.02395353466272354,
      "pose_mae_dy": 0.02264353446662426,
      "pose_rmse_dtheta": 0.165268212556839,
      "pose_rmse_dx": 0.0749935656785965,
      "pose_rmse_dy": 0.056672487407922745,
      "pose_rmse_mean": 0.09897809475660324,
      "rmse_dtheta": 0.022970762103796005,
      "rmse_dx": 0.006872641853988171,
      "rmse_dy": 0.006020275875926018,
      "rmse_mean": 0.01195456087589264,
      "rotation_flip": 0.004761904943734407,
      "sparse_tokens": 32137.0,
      "step": 4492,
      "turn_loss": 0.06895045936107635,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.20874372793161122,
      "grad_norm": 0.30770519375801086,
      "learning_rate": 7.014338552863178e-06,
      "loss": 0.0971,
      "mae_dtheta": 0.024244170635938644,
      "mae_dx": 0.010440198704600334,
      "mae_dy": 0.004462962970137596,
      "pose_mae_dtheta": 0.2099456936120987,
      "pose_mae_dx": 0.09731055796146393,
      "pose_mae_dy": 0.05455702170729637,
      "pose_rmse_dtheta": 0.3313944935798645,
      "pose_rmse_dx": 0.18650804460048676,
      "pose_rmse_dy": 0.10792683809995651,
      "pose_rmse_mean": 0.20860980451107025,
      "rmse_dtheta": 0.03746136277914047,
      "rmse_dx": 0.019919289276003838,
      "rmse_dy": 0.00732190627604723,
      "rmse_mean": 0.02156752161681652,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 5570.0,
      "step": 4493,
      "turn_loss": 0.20756617188453674,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.208790187697454,
      "grad_norm": 0.6824772357940674,
      "learning_rate": 7.013128310518831e-06,
      "loss": 0.115,
      "mae_dtheta": 0.012081766501069069,
      "mae_dx": 0.0024427734315395355,
      "mae_dy": 0.0029936744831502438,
      "pose_mae_dtheta": 0.08750159293413162,
      "pose_mae_dx": 0.029415102675557137,
      "pose_mae_dy": 0.03949517011642456,
      "pose_rmse_dtheta": 0.1787009984254837,
      "pose_rmse_dx": 0.08429709821939468,
      "pose_rmse_dy": 0.09501082450151443,
      "pose_rmse_mean": 0.11933630704879761,
      "rmse_dtheta": 0.022317711263895035,
      "rmse_dx": 0.007293604779988527,
      "rmse_dy": 0.00643099145963788,
      "rmse_mean": 0.012014102190732956,
      "rotation_flip": 0.005231037270277739,
      "sparse_tokens": 32073.0,
      "step": 4494,
      "turn_loss": 0.09699637442827225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.20883664746329678,
      "grad_norm": 0.43062230944633484,
      "learning_rate": 7.011917927395341e-06,
      "loss": 0.1567,
      "mae_dtheta": 0.011085912585258484,
      "mae_dx": 0.002603948814794421,
      "mae_dy": 0.0032167634926736355,
      "pose_mae_dtheta": 0.08031558245420456,
      "pose_mae_dx": 0.030924582853913307,
      "pose_mae_dy": 0.0352499820291996,
      "pose_rmse_dtheta": 0.17034117877483368,
      "pose_rmse_dx": 0.08675460517406464,
      "pose_rmse_dy": 0.07689131051301956,
      "pose_rmse_mean": 0.11132903397083282,
      "rmse_dtheta": 0.023680074140429497,
      "rmse_dx": 0.007941639050841331,
      "rmse_dy": 0.007510076276957989,
      "rmse_mean": 0.013043930754065514,
      "rotation_flip": 0.007496251724660397,
      "sparse_tokens": 32105.0,
      "step": 4495,
      "turn_loss": 0.10037872940301895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.20888310722913955,
      "grad_norm": 0.9294784665107727,
      "learning_rate": 7.010707403577349e-06,
      "loss": 0.2188,
      "mae_dtheta": 0.037826452404260635,
      "mae_dx": 0.009569273330271244,
      "mae_dy": 0.006726536434143782,
      "pose_mae_dtheta": 0.30863457918167114,
      "pose_mae_dx": 0.09128578752279282,
      "pose_mae_dy": 0.08120224624872208,
      "pose_rmse_dtheta": 0.5678783059120178,
      "pose_rmse_dx": 0.1973828375339508,
      "pose_rmse_dy": 0.17042797803878784,
      "pose_rmse_mean": 0.3118963837623596,
      "rmse_dtheta": 0.05902951955795288,
      "rmse_dx": 0.020266542211174965,
      "rmse_dy": 0.012616549618542194,
      "rmse_mean": 0.03063753806054592,
      "rotation_flip": 0.003968254197388887,
      "sparse_tokens": 5196.0,
      "step": 4496,
      "turn_loss": 0.3020716607570648,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.20892956699498236,
      "grad_norm": 0.5803288817405701,
      "learning_rate": 7.0094967391495095e-06,
      "loss": 0.1615,
      "mae_dtheta": 0.007778551429510117,
      "mae_dx": 0.0030534607358276844,
      "mae_dy": 0.0009021202567964792,
      "pose_mae_dtheta": 0.05587685480713844,
      "pose_mae_dx": 0.026218555867671967,
      "pose_mae_dy": 0.01049233041703701,
      "pose_rmse_dtheta": 0.17964516580104828,
      "pose_rmse_dx": 0.05702529102563858,
      "pose_rmse_dy": 0.03363346308469772,
      "pose_rmse_mean": 0.09010131657123566,
      "rmse_dtheta": 0.02204206772148609,
      "rmse_dx": 0.007785785011947155,
      "rmse_dy": 0.0022890993859618902,
      "rmse_mean": 0.010705649852752686,
      "rotation_flip": 0.004201680887490511,
      "sparse_tokens": 32233.0,
      "step": 4497,
      "turn_loss": 0.08879445493221283,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.20897602676082513,
      "grad_norm": 0.39156800508499146,
      "learning_rate": 7.008285934196485e-06,
      "loss": 0.0833,
      "mae_dtheta": 0.009510239586234093,
      "mae_dx": 0.002018732251599431,
      "mae_dy": 0.0012977179139852524,
      "pose_mae_dtheta": 0.07746291160583496,
      "pose_mae_dx": 0.019842499867081642,
      "pose_mae_dy": 0.018086975440382957,
      "pose_rmse_dtheta": 0.26007771492004395,
      "pose_rmse_dx": 0.052297063171863556,
      "pose_rmse_dy": 0.05261770635843277,
      "pose_rmse_mean": 0.12166415899991989,
      "rmse_dtheta": 0.027002012357115746,
      "rmse_dx": 0.006176977884024382,
      "rmse_dy": 0.003236734075471759,
      "rmse_mean": 0.01213857438415289,
      "rotation_flip": 0.0,
      "sparse_tokens": 32169.0,
      "step": 4498,
      "turn_loss": 0.05885006859898567,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.2090224865266679,
      "grad_norm": 0.7118732929229736,
      "learning_rate": 7.007074988802946e-06,
      "loss": 0.1745,
      "mae_dtheta": 0.032878533005714417,
      "mae_dx": 0.011534873396158218,
      "mae_dy": 0.008294254541397095,
      "pose_mae_dtheta": 0.2864019274711609,
      "pose_mae_dx": 0.09915803372859955,
      "pose_mae_dy": 0.10669147223234177,
      "pose_rmse_dtheta": 0.5245551466941833,
      "pose_rmse_dx": 0.22390396893024445,
      "pose_rmse_dy": 0.2586386799812317,
      "pose_rmse_mean": 0.33569926023483276,
      "rmse_dtheta": 0.05281514301896095,
      "rmse_dx": 0.024416279047727585,
      "rmse_dy": 0.016213133931159973,
      "rmse_mean": 0.031148185953497887,
      "rotation_flip": 0.016460904851555824,
      "sparse_tokens": 11172.0,
      "step": 4499,
      "turn_loss": 0.33458778262138367,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2090689462925107,
      "grad_norm": 0.6156108975410461,
      "learning_rate": 7.005863903053578e-06,
      "loss": 0.1908,
      "mae_dtheta": 0.008568927645683289,
      "mae_dx": 0.0037347222678363323,
      "mae_dy": 0.0006471849628724158,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6156108379364014,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 166.3854522705078,
      "model/head/act_norm_mean": 129.02999723800505,
      "model/head/act_norm_min": 73.24407958984375,
      "model/head/act_over_embed": 88.67062209982353,
      "model/head/grad_frac": 0.1088160052895546,
      "model/head/grad_norm": 0.06698831170797348,
      "model/head/grad_zero_frac": 0.00015673224697820842,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6910314078282829,
      "model/head/update_ratio": 0.0011492081684991717,
      "model/head/weight_delta": 7.894078731536865,
      "model/head/weight_delta_rel": 0.13848552107810974,
      "model/head/weight_norm": 58.29084396362305,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4188433289527893,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41878378544754224,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4187174141407013,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2877921380751223,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07826025038957596,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04817785695195198,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5424657993562232,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015594291035085917,
      "model/modality_embedder.encoders.pose/weight_delta": 2.5940566062927246,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08475591242313385,
      "model/modality_embedder.encoders.pose/weight_norm": 30.894548416137695,
      "model/modality_embedder/grad_frac": 0.07826025038957596,
      "model/modality_embedder/grad_norm": 0.04817785695195198,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5424657993562232,
      "model/modality_embedder/update_ratio": 0.0015594291035085917,
      "model/modality_embedder/weight_delta": 2.5940566062927246,
      "model/modality_embedder/weight_delta_rel": 0.08475591242313385,
      "model/modality_embedder/weight_norm": 30.894548416137695,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.0583267211914,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.43634259259259,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.091965675354004,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.480092768420917,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.12197494506835938,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.07508909702301025,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0027029868215322495,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.9012147188186646,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06928141415119171,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.780046463012695,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.22428894042969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.545835337502005,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.386031150817871,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.242546569957398,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.115114226937294,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07086556404829025,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0024045214522629976,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.403745651245117,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08326762914657593,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.47179412841797,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.1162109375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.431141774891774,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.425031661987305,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.538146804248605,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.1083734929561615,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06671589612960815,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002192810410633683,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.5830917358398438,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08673538267612457,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.424835205078125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.16889190673828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 30.156380270963606,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.052167892456055,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.723746850686446,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10827233642339706,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06665362417697906,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022426298819482327,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.2044363021850586,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07533717155456543,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.721187591552734,
      "model/normalizer/grad_frac": 0.46133628487586975,
      "model/normalizer/grad_norm": 0.2840036153793335,
      "model/normalizer/grad_zero_frac": 0.00018671466386877,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0036260904744267464,
      "model/normalizer/weight_delta": 4.681337356567383,
      "model/normalizer/weight_delta_rel": 0.060292914509773254,
      "model/normalizer/weight_norm": 78.322265625,
      "pose_mae_dtheta": 0.05904359370470047,
      "pose_mae_dx": 0.03595862165093422,
      "pose_mae_dy": 0.009112034924328327,
      "pose_rmse_dtheta": 0.21847271919250488,
      "pose_rmse_dx": 0.09502580761909485,
      "pose_rmse_dy": 0.02742571383714676,
      "pose_rmse_mean": 0.1136414110660553,
      "rmse_dtheta": 0.02847345732152462,
      "rmse_dx": 0.011025804094970226,
      "rmse_dy": 0.0019167744321748614,
      "rmse_mean": 0.013805344700813293,
      "rotation_flip": 0.0028184892144054174,
      "sparse_tokens": 32185.0,
      "step": 4500,
      "turn_loss": 0.10721828788518906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20911540605835346,
      "grad_norm": 0.5320613384246826,
      "learning_rate": 7.004652677033069e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.010349907912313938,
      "mae_dx": 0.0019800683949142694,
      "mae_dy": 0.0033067662734538317,
      "pose_mae_dtheta": 0.07780064642429352,
      "pose_mae_dx": 0.03136374056339264,
      "pose_mae_dy": 0.042863503098487854,
      "pose_rmse_dtheta": 0.16584765911102295,
      "pose_rmse_dx": 0.10382059216499329,
      "pose_rmse_dy": 0.12443104386329651,
      "pose_rmse_mean": 0.13136643171310425,
      "rmse_dtheta": 0.020323535427451134,
      "rmse_dx": 0.005845407489687204,
      "rmse_dy": 0.009179321117699146,
      "rmse_mean": 0.011782754212617874,
      "rotation_flip": 0.0027966441120952368,
      "sparse_tokens": 32089.0,
      "step": 4501,
      "turn_loss": 0.09728545695543289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20916186582419624,
      "grad_norm": 0.5517828464508057,
      "learning_rate": 7.003441310826124e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.013806157745420933,
      "mae_dx": 0.0021467492915689945,
      "mae_dy": 0.002747969701886177,
      "pose_mae_dtheta": 0.10135836899280548,
      "pose_mae_dx": 0.027877746149897575,
      "pose_mae_dy": 0.03139210119843483,
      "pose_rmse_dtheta": 0.27668261528015137,
      "pose_rmse_dx": 0.08252454549074173,
      "pose_rmse_dy": 0.07156511396169662,
      "pose_rmse_mean": 0.1435907632112503,
      "rmse_dtheta": 0.030835025012493134,
      "rmse_dx": 0.006224700715392828,
      "rmse_dy": 0.0063344999216496944,
      "rmse_mean": 0.014464741572737694,
      "rotation_flip": 0.008973858319222927,
      "sparse_tokens": 32073.0,
      "step": 4502,
      "turn_loss": 0.12335389852523804,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.20920832559003902,
      "grad_norm": 0.5062063336372375,
      "learning_rate": 7.00222980451745e-06,
      "loss": 0.1032,
      "mae_dtheta": 0.009841429069638252,
      "mae_dx": 0.0020110367331653833,
      "mae_dy": 0.0033368368167430162,
      "pose_mae_dtheta": 0.06406166404485703,
      "pose_mae_dx": 0.030892163515090942,
      "pose_mae_dy": 0.030859334394335747,
      "pose_rmse_dtheta": 0.14622385799884796,
      "pose_rmse_dx": 0.07646158337593079,
      "pose_rmse_dy": 0.06931349635124207,
      "pose_rmse_mean": 0.09733297675848007,
      "rmse_dtheta": 0.019916608929634094,
      "rmse_dx": 0.004881739150732756,
      "rmse_dy": 0.007173711434006691,
      "rmse_mean": 0.010657353326678276,
      "rotation_flip": 0.0013879250036552548,
      "sparse_tokens": 32121.0,
      "step": 4503,
      "turn_loss": 0.08804409950971603,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2092547853558818,
      "grad_norm": 0.6085969805717468,
      "learning_rate": 7.001018158191772e-06,
      "loss": 0.1421,
      "mae_dtheta": 0.011663325130939484,
      "mae_dx": 0.0036310264840722084,
      "mae_dy": 0.0026816348545253277,
      "pose_mae_dtheta": 0.0895790159702301,
      "pose_mae_dx": 0.040596652776002884,
      "pose_mae_dy": 0.03937593847513199,
      "pose_rmse_dtheta": 0.22044271230697632,
      "pose_rmse_dx": 0.08496737480163574,
      "pose_rmse_dy": 0.1001354306936264,
      "pose_rmse_mean": 0.13518184423446655,
      "rmse_dtheta": 0.026830915361642838,
      "rmse_dx": 0.008648887276649475,
      "rmse_dy": 0.005822069011628628,
      "rmse_mean": 0.013767290860414505,
      "rotation_flip": 0.0029523407574743032,
      "sparse_tokens": 32137.0,
      "step": 4504,
      "turn_loss": 0.11439348757266998,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.2093012451217246,
      "grad_norm": 0.4496414065361023,
      "learning_rate": 6.9998063719338214e-06,
      "loss": 0.1206,
      "mae_dtheta": 0.008749286644160748,
      "mae_dx": 0.0018184391083195806,
      "mae_dy": 0.00045677306479774415,
      "pose_mae_dtheta": 0.06216180697083473,
      "pose_mae_dx": 0.015908919274806976,
      "pose_mae_dy": 0.006595207843929529,
      "pose_rmse_dtheta": 0.2330833226442337,
      "pose_rmse_dx": 0.03818492591381073,
      "pose_rmse_dy": 0.030489400029182434,
      "pose_rmse_mean": 0.10058587789535522,
      "rmse_dtheta": 0.029282910749316216,
      "rmse_dx": 0.00445121806114912,
      "rmse_dy": 0.00176393857691437,
      "rmse_mean": 0.011832689866423607,
      "rotation_flip": 0.0,
      "sparse_tokens": 32233.0,
      "step": 4505,
      "turn_loss": 0.0540141835808754,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.20934770488756738,
      "grad_norm": 0.7499976754188538,
      "learning_rate": 6.9985944458283375e-06,
      "loss": 0.1733,
      "mae_dtheta": 0.042252328246831894,
      "mae_dx": 0.0135519839823246,
      "mae_dy": 0.005863068159669638,
      "pose_mae_dtheta": 0.3319895565509796,
      "pose_mae_dx": 0.09623278677463531,
      "pose_mae_dy": 0.06685151159763336,
      "pose_rmse_dtheta": 0.562975287437439,
      "pose_rmse_dx": 0.20775988698005676,
      "pose_rmse_dy": 0.18080490827560425,
      "pose_rmse_mean": 0.3171800374984741,
      "rmse_dtheta": 0.06151827797293663,
      "rmse_dx": 0.026612386107444763,
      "rmse_dy": 0.014956706203520298,
      "rmse_mean": 0.03436245769262314,
      "rotation_flip": 0.014388489536941051,
      "sparse_tokens": 13385.0,
      "step": 4506,
      "turn_loss": 0.3001903295516968,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.20939416465341015,
      "grad_norm": 0.6580137014389038,
      "learning_rate": 6.997382379960072e-06,
      "loss": 0.1355,
      "mae_dtheta": 0.010134886018931866,
      "mae_dx": 0.0020383396185934544,
      "mae_dy": 0.001104295952245593,
      "pose_mae_dtheta": 0.0755612701177597,
      "pose_mae_dx": 0.01855217106640339,
      "pose_mae_dy": 0.013382199220359325,
      "pose_rmse_dtheta": 0.23429803550243378,
      "pose_rmse_dx": 0.046162720769643784,
      "pose_rmse_dy": 0.04251670464873314,
      "pose_rmse_mean": 0.10765915364027023,
      "rmse_dtheta": 0.0290507934987545,
      "rmse_dx": 0.00544157437980175,
      "rmse_dy": 0.003703769762068987,
      "rmse_mean": 0.012732045724987984,
      "rotation_flip": 0.0021645021624863148,
      "sparse_tokens": 32249.0,
      "step": 4507,
      "turn_loss": 0.05818016454577446,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.20944062441925293,
      "grad_norm": 0.5147082805633545,
      "learning_rate": 6.996170174413784e-06,
      "loss": 0.1323,
      "mae_dtheta": 0.00912702176719904,
      "mae_dx": 0.002317588310688734,
      "mae_dy": 0.002567702205851674,
      "pose_mae_dtheta": 0.06421445310115814,
      "pose_mae_dx": 0.030930213630199432,
      "pose_mae_dy": 0.02845735475420952,
      "pose_rmse_dtheta": 0.17067371308803558,
      "pose_rmse_dx": 0.10147761553525925,
      "pose_rmse_dy": 0.07426312565803528,
      "pose_rmse_mean": 0.1154714822769165,
      "rmse_dtheta": 0.021909650415182114,
      "rmse_dx": 0.00769800553098321,
      "rmse_dy": 0.006609317846596241,
      "rmse_mean": 0.012072324752807617,
      "rotation_flip": 0.003237742930650711,
      "sparse_tokens": 32057.0,
      "step": 4508,
      "turn_loss": 0.07489114999771118,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2094870841850957,
      "grad_norm": 0.4905913472175598,
      "learning_rate": 6.994957829274244e-06,
      "loss": 0.0771,
      "mae_dtheta": 0.008532819338142872,
      "mae_dx": 0.0018339231610298157,
      "mae_dy": 0.0011967389145866036,
      "pose_mae_dtheta": 0.06696736067533493,
      "pose_mae_dx": 0.015317108482122421,
      "pose_mae_dy": 0.013501323759555817,
      "pose_rmse_dtheta": 0.24834127724170685,
      "pose_rmse_dx": 0.03944423422217369,
      "pose_rmse_dy": 0.03979315236210823,
      "pose_rmse_mean": 0.10919289290904999,
      "rmse_dtheta": 0.026450438424944878,
      "rmse_dx": 0.005668111611157656,
      "rmse_dy": 0.003082779934629798,
      "rmse_mean": 0.01173377688974142,
      "rotation_flip": 0.0030581040773540735,
      "sparse_tokens": 32153.0,
      "step": 4509,
      "turn_loss": 0.05571351945400238,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.20953354395093848,
      "grad_norm": 0.4077082872390747,
      "learning_rate": 6.993745344626232e-06,
      "loss": 0.1252,
      "mae_dtheta": 0.007004787214100361,
      "mae_dx": 0.0012603644281625748,
      "mae_dy": 0.0014656117418780923,
      "pose_mae_dtheta": 0.048887599259614944,
      "pose_mae_dx": 0.015428331680595875,
      "pose_mae_dy": 0.02368914522230625,
      "pose_rmse_dtheta": 0.10195470601320267,
      "pose_rmse_dx": 0.03814242035150528,
      "pose_rmse_dy": 0.06740377098321915,
      "pose_rmse_mean": 0.06916697323322296,
      "rmse_dtheta": 0.01457938551902771,
      "rmse_dx": 0.0036426419392228127,
      "rmse_dy": 0.003297192743048072,
      "rmse_mean": 0.007173073478043079,
      "rotation_flip": 0.006090597715228796,
      "sparse_tokens": 32169.0,
      "step": 4510,
      "turn_loss": 0.061681024730205536,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.20958000371678126,
      "grad_norm": 0.39172041416168213,
      "learning_rate": 6.992532720554538e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.008456971496343613,
      "mae_dx": 0.0016511209541931748,
      "mae_dy": 0.0015662615187466145,
      "pose_mae_dtheta": 0.06083768233656883,
      "pose_mae_dx": 0.01908152736723423,
      "pose_mae_dy": 0.02027962915599346,
      "pose_rmse_dtheta": 0.17558221518993378,
      "pose_rmse_dx": 0.05307932198047638,
      "pose_rmse_dy": 0.05335981771349907,
      "pose_rmse_mean": 0.09400711953639984,
      "rmse_dtheta": 0.02230193093419075,
      "rmse_dx": 0.0054620071314275265,
      "rmse_dy": 0.003830611240118742,
      "rmse_mean": 0.010531516745686531,
      "rotation_flip": 0.0013831258984282613,
      "sparse_tokens": 32137.0,
      "step": 4511,
      "turn_loss": 0.05965288728475571,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 44138.0,
      "epoch": 0.20962646348262404,
      "grad_norm": 0.7851119637489319,
      "learning_rate": 6.9913199571439615e-06,
      "loss": 0.1939,
      "mae_dtheta": 0.03325285762548447,
      "mae_dx": 0.011420742608606815,
      "mae_dy": 0.005031799431890249,
      "pose_mae_dtheta": 0.2525489330291748,
      "pose_mae_dx": 0.08420626074075699,
      "pose_mae_dy": 0.056086428463459015,
      "pose_rmse_dtheta": 0.435552179813385,
      "pose_rmse_dx": 0.18785887956619263,
      "pose_rmse_dy": 0.15033094584941864,
      "pose_rmse_mean": 0.2579140067100525,
      "rmse_dtheta": 0.05054742470383644,
      "rmse_dx": 0.023072198033332825,
      "rmse_dy": 0.011990603059530258,
      "rmse_mean": 0.02853674255311489,
      "rotation_flip": 0.008942661806941032,
      "sparse_tokens": 30338.0,
      "step": 4512,
      "turn_loss": 0.26324552297592163,
      "turns": 136.0,
      "turns_per_sample": 136.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20967292324846684,
      "grad_norm": 0.6896709203720093,
      "learning_rate": 6.990107054479313e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.009966176003217697,
      "mae_dx": 0.002173894550651312,
      "mae_dy": 0.002332874806597829,
      "pose_mae_dtheta": 0.07305043935775757,
      "pose_mae_dx": 0.027111047878861427,
      "pose_mae_dy": 0.033372074365615845,
      "pose_rmse_dtheta": 0.16377092897891998,
      "pose_rmse_dx": 0.07522410154342651,
      "pose_rmse_dy": 0.09170296043157578,
      "pose_rmse_mean": 0.11023266613483429,
      "rmse_dtheta": 0.020794657990336418,
      "rmse_dx": 0.006967530120164156,
      "rmse_dy": 0.006155058275908232,
      "rmse_mean": 0.011305748485028744,
      "rotation_flip": 0.004226542543619871,
      "sparse_tokens": 32073.0,
      "step": 4513,
      "turn_loss": 0.0815931111574173,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.20971938301430962,
      "grad_norm": 0.5600729584693909,
      "learning_rate": 6.988894012645409e-06,
      "loss": 0.2204,
      "mae_dtheta": 0.03899577632546425,
      "mae_dx": 0.00787340383976698,
      "mae_dy": 0.0043992772698402405,
      "pose_mae_dtheta": 0.30257850885391235,
      "pose_mae_dx": 0.06311121582984924,
      "pose_mae_dy": 0.04045158997178078,
      "pose_rmse_dtheta": 0.5529420375823975,
      "pose_rmse_dx": 0.15606527030467987,
      "pose_rmse_dy": 0.110879085958004,
      "pose_rmse_mean": 0.27329546213150024,
      "rmse_dtheta": 0.059556640684604645,
      "rmse_dx": 0.01796896755695343,
      "rmse_dy": 0.010903013870120049,
      "rmse_mean": 0.029476208612322807,
      "rotation_flip": 0.015441176481544971,
      "sparse_tokens": 22677.0,
      "step": 4514,
      "turn_loss": 0.25906503200531006,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2097658427801524,
      "grad_norm": 0.5276020765304565,
      "learning_rate": 6.987680831727078e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.007069142535328865,
      "mae_dx": 0.002110743196681142,
      "mae_dy": 0.0013494305312633514,
      "pose_mae_dtheta": 0.050559863448143005,
      "pose_mae_dx": 0.02414197288453579,
      "pose_mae_dy": 0.01940460503101349,
      "pose_rmse_dtheta": 0.1318623572587967,
      "pose_rmse_dx": 0.06380732357501984,
      "pose_rmse_dy": 0.049634311348199844,
      "pose_rmse_mean": 0.08176799863576889,
      "rmse_dtheta": 0.017502401024103165,
      "rmse_dx": 0.0066316695883870125,
      "rmse_dy": 0.003169543342664838,
      "rmse_mean": 0.009101204574108124,
      "rotation_flip": 0.003775959834456444,
      "sparse_tokens": 32057.0,
      "step": 4515,
      "turn_loss": 0.06539535522460938,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.20981230254599517,
      "grad_norm": 0.6320242881774902,
      "learning_rate": 6.98646751180916e-06,
      "loss": 0.1889,
      "mae_dtheta": 0.012577429413795471,
      "mae_dx": 0.002635922282934189,
      "mae_dy": 0.0031181233935058117,
      "pose_mae_dtheta": 0.09240557253360748,
      "pose_mae_dx": 0.034436848014593124,
      "pose_mae_dy": 0.03493551164865494,
      "pose_rmse_dtheta": 0.223555326461792,
      "pose_rmse_dx": 0.08727246522903442,
      "pose_rmse_dy": 0.07756118476390839,
      "pose_rmse_mean": 0.12946300208568573,
      "rmse_dtheta": 0.02741115726530552,
      "rmse_dx": 0.008095995523035526,
      "rmse_dy": 0.007471796590834856,
      "rmse_mean": 0.014326317235827446,
      "rotation_flip": 0.004755728412419558,
      "sparse_tokens": 32089.0,
      "step": 4516,
      "turn_loss": 0.11366000026464462,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.20985876231183795,
      "grad_norm": 0.6275989413261414,
      "learning_rate": 6.985254052976502e-06,
      "loss": 0.1704,
      "mae_dtheta": 0.015427108854055405,
      "mae_dx": 0.002406381070613861,
      "mae_dy": 0.004387511406093836,
      "pose_mae_dtheta": 0.1131192222237587,
      "pose_mae_dx": 0.032183218747377396,
      "pose_mae_dy": 0.0418226458132267,
      "pose_rmse_dtheta": 0.2553621530532837,
      "pose_rmse_dx": 0.08833310008049011,
      "pose_rmse_dy": 0.09057877212762833,
      "pose_rmse_mean": 0.14475801587104797,
      "rmse_dtheta": 0.030545882880687714,
      "rmse_dx": 0.006690812762826681,
      "rmse_dy": 0.009939244017004967,
      "rmse_mean": 0.015725312754511833,
      "rotation_flip": 0.007014028262346983,
      "sparse_tokens": 32073.0,
      "step": 4517,
      "turn_loss": 0.1401137411594391,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.20990522207768073,
      "grad_norm": 0.6113117337226868,
      "learning_rate": 6.984040455313965e-06,
      "loss": 0.1131,
      "mae_dtheta": 0.007071804255247116,
      "mae_dx": 0.0018044362077489495,
      "mae_dy": 0.0017235697014257312,
      "pose_mae_dtheta": 0.04777979850769043,
      "pose_mae_dx": 0.022572020068764687,
      "pose_mae_dy": 0.019774649292230606,
      "pose_rmse_dtheta": 0.1445818990468979,
      "pose_rmse_dx": 0.06064378097653389,
      "pose_rmse_dy": 0.049888912588357925,
      "pose_rmse_mean": 0.0850382000207901,
      "rmse_dtheta": 0.017470000311732292,
      "rmse_dx": 0.005367047619074583,
      "rmse_dy": 0.004867069888859987,
      "rmse_mean": 0.009234705939888954,
      "rotation_flip": 0.0034782609436661005,
      "sparse_tokens": 32137.0,
      "step": 4518,
      "turn_loss": 0.06996864080429077,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2099516818435235,
      "grad_norm": 0.6154173612594604,
      "learning_rate": 6.9828267189064125e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.011744816787540913,
      "mae_dx": 0.003011158434674144,
      "mae_dy": 0.003456740640103817,
      "pose_mae_dtheta": 0.08172907680273056,
      "pose_mae_dx": 0.034447431564331055,
      "pose_mae_dy": 0.03446946665644646,
      "pose_rmse_dtheta": 0.18056461215019226,
      "pose_rmse_dx": 0.10645386576652527,
      "pose_rmse_dy": 0.08232385665178299,
      "pose_rmse_mean": 0.12311410903930664,
      "rmse_dtheta": 0.024293754249811172,
      "rmse_dx": 0.009363485500216484,
      "rmse_dy": 0.008864578790962696,
      "rmse_mean": 0.014173938892781734,
      "rotation_flip": 0.006533575244247913,
      "sparse_tokens": 32089.0,
      "step": 4519,
      "turn_loss": 0.1288948953151703,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.20999814160936628,
      "grad_norm": 0.5540956854820251,
      "learning_rate": 6.981612843838723e-06,
      "loss": 0.129,
      "mae_dtheta": 0.030459657311439514,
      "mae_dx": 0.014400762505829334,
      "mae_dy": 0.0055869328789412975,
      "pose_mae_dtheta": 0.2846829295158386,
      "pose_mae_dx": 0.13688252866268158,
      "pose_mae_dy": 0.07399857044219971,
      "pose_rmse_dtheta": 0.4320659935474396,
      "pose_rmse_dx": 0.27251213788986206,
      "pose_rmse_dy": 0.1529601663351059,
      "pose_rmse_mean": 0.28584611415863037,
      "rmse_dtheta": 0.04602755606174469,
      "rmse_dx": 0.027473997324705124,
      "rmse_dy": 0.009754892438650131,
      "rmse_mean": 0.02775215171277523,
      "rotation_flip": 0.012048192322254181,
      "sparse_tokens": 4766.0,
      "step": 4520,
      "turn_loss": 0.4561474323272705,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.21004460137520906,
      "grad_norm": 0.5092043280601501,
      "learning_rate": 6.980398830195785e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.040720101445913315,
      "mae_dx": 0.015306142158806324,
      "mae_dy": 0.004578635096549988,
      "pose_mae_dtheta": 0.35796573758125305,
      "pose_mae_dx": 0.11464816331863403,
      "pose_mae_dy": 0.06417021155357361,
      "pose_rmse_dtheta": 0.589372456073761,
      "pose_rmse_dx": 0.23705533146858215,
      "pose_rmse_dy": 0.1395408809185028,
      "pose_rmse_mean": 0.32198959589004517,
      "rmse_dtheta": 0.05894105136394501,
      "rmse_dx": 0.028243346139788628,
      "rmse_dy": 0.008159957826137543,
      "rmse_mean": 0.031781453639268875,
      "rotation_flip": 0.007594936527311802,
      "sparse_tokens": 6487.0,
      "step": 4521,
      "turn_loss": 0.21924875676631927,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.21009106114105186,
      "grad_norm": 0.5349403023719788,
      "learning_rate": 6.979184678062493e-06,
      "loss": 0.109,
      "mae_dtheta": 0.039666201919317245,
      "mae_dx": 0.010444574989378452,
      "mae_dy": 0.004802059382200241,
      "pose_mae_dtheta": 0.3072526156902313,
      "pose_mae_dx": 0.06756830215454102,
      "pose_mae_dy": 0.06027711182832718,
      "pose_rmse_dtheta": 0.5751323699951172,
      "pose_rmse_dx": 0.1600949466228485,
      "pose_rmse_dy": 0.15353040397167206,
      "pose_rmse_mean": 0.29625260829925537,
      "rmse_dtheta": 0.06186143681406975,
      "rmse_dx": 0.02181464433670044,
      "rmse_dy": 0.010047433897852898,
      "rmse_mean": 0.031241174787282944,
      "rotation_flip": 0.006036217324435711,
      "sparse_tokens": 8712.0,
      "step": 4522,
      "turn_loss": 0.22893807291984558,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.21013752090689464,
      "grad_norm": 0.890846312046051,
      "learning_rate": 6.977970387523754e-06,
      "loss": 0.2819,
      "mae_dtheta": 0.03696905076503754,
      "mae_dx": 0.011428381316363811,
      "mae_dy": 0.004185521509498358,
      "pose_mae_dtheta": 0.29253891110420227,
      "pose_mae_dx": 0.11265035718679428,
      "pose_mae_dy": 0.046804893761873245,
      "pose_rmse_dtheta": 0.5174148678779602,
      "pose_rmse_dx": 0.2377367913722992,
      "pose_rmse_dy": 0.09722945094108582,
      "pose_rmse_mean": 0.28412705659866333,
      "rmse_dtheta": 0.05709156021475792,
      "rmse_dx": 0.022515583783388138,
      "rmse_dy": 0.008315971121191978,
      "rmse_mean": 0.029307706281542778,
      "rotation_flip": 0.023076923564076424,
      "sparse_tokens": 6540.0,
      "step": 4523,
      "turn_loss": 0.21936845779418945,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2101839806727374,
      "grad_norm": 0.5307735204696655,
      "learning_rate": 6.976755958664485e-06,
      "loss": 0.1108,
      "mae_dtheta": 0.006873603910207748,
      "mae_dx": 0.0011957809329032898,
      "mae_dy": 0.0009785667061805725,
      "pose_mae_dtheta": 0.05180129408836365,
      "pose_mae_dx": 0.011690488085150719,
      "pose_mae_dy": 0.017442133277654648,
      "pose_rmse_dtheta": 0.16834098100662231,
      "pose_rmse_dx": 0.027431990951299667,
      "pose_rmse_dy": 0.03544999286532402,
      "pose_rmse_mean": 0.0770743265748024,
      "rmse_dtheta": 0.02067635953426361,
      "rmse_dx": 0.0035710567608475685,
      "rmse_dy": 0.001920323702506721,
      "rmse_mean": 0.008722580038011074,
      "rotation_flip": 0.0037157454062253237,
      "sparse_tokens": 32121.0,
      "step": 4524,
      "turn_loss": 0.04810531064867973,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.2102304404385802,
      "grad_norm": 0.6417573094367981,
      "learning_rate": 6.9755413915696105e-06,
      "loss": 0.1586,
      "mae_dtheta": 0.03757049888372421,
      "mae_dx": 0.01308200228959322,
      "mae_dy": 0.0049053821712732315,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6417573094367981,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 139.59768676757812,
      "model/head/act_norm_mean": 106.43456380208333,
      "model/head/act_norm_min": 62.977210998535156,
      "model/head/act_over_embed": 73.1428287008774,
      "model/head/grad_frac": 0.11111339926719666,
      "model/head/grad_norm": 0.07130783796310425,
      "model/head/grad_zero_frac": 0.0001817967277020216,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.68828125,
      "model/head/update_ratio": 0.0012232055887579918,
      "model/head/weight_delta": 7.915091037750244,
      "model/head/weight_delta_rel": 0.13885414600372314,
      "model/head/weight_norm": 58.295875549316406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4188929498195648,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4188929498195648,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4188929498195648,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28786715685358916,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06807436048984528,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04368722066283226,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014140013372525573,
      "model/modality_embedder.encoders.pose/weight_delta": 2.597245216369629,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08486009389162064,
      "model/modality_embedder.encoders.pose/weight_norm": 30.89616584777832,
      "model/modality_embedder/grad_frac": 0.06807436048984528,
      "model/modality_embedder/grad_norm": 0.04368722066283226,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0014140013372525573,
      "model/modality_embedder/weight_delta": 2.597245216369629,
      "model/modality_embedder/weight_delta_rel": 0.08486009389162064,
      "model/modality_embedder/weight_norm": 30.89616584777832,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.5855712890625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.230543981481482,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.065352439880371,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.964247311853406,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07920044660568237,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05082746595144272,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018295131158083677,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.908697247505188,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06955408304929733,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.781963348388672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.81584930419922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.083007605820107,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.483138084411621,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.5500682953891,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08318862318992615,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.053386908024549484,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001811290974728763,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.413527488708496,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08360648155212402,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.474506378173828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.96068572998047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.699426256613755,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.776694297790527,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.66088632536433,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0895245149731636,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.057453010231256485,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018881616415455937,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.5939483642578125,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08709993213415146,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.428014755249023,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.43286895751953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.63756283068783,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.79258918762207,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.992791924188523,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0999576523900032,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06414855271577835,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002158224117010832,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.2135837078094482,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07564978301525116,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.722841262817383,
      "model/normalizer/grad_frac": 0.3665579855442047,
      "model/normalizer/grad_norm": 0.23524126410484314,
      "model/normalizer/grad_zero_frac": 0.00017607901827432215,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003003388177603483,
      "model/normalizer/weight_delta": 4.70052433013916,
      "model/normalizer/weight_delta_rel": 0.060540031641721725,
      "model/normalizer/weight_norm": 78.3252944946289,
      "pose_mae_dtheta": 0.306288480758667,
      "pose_mae_dx": 0.09542907774448395,
      "pose_mae_dy": 0.055629242211580276,
      "pose_rmse_dtheta": 0.5145973563194275,
      "pose_rmse_dx": 0.20232385396957397,
      "pose_rmse_dy": 0.12459871917963028,
      "pose_rmse_mean": 0.2805066704750061,
      "rmse_dtheta": 0.05428401380777359,
      "rmse_dx": 0.024887073785066605,
      "rmse_dy": 0.009600290097296238,
      "rmse_mean": 0.029590461403131485,
      "rotation_flip": 0.023356402292847633,
      "sparse_tokens": 19802.0,
      "step": 4525,
      "turn_loss": 0.27506574988365173,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21027690020442297,
      "grad_norm": 0.6935600638389587,
      "learning_rate": 6.974326686324065e-06,
      "loss": 0.1134,
      "mae_dtheta": 0.010836624540388584,
      "mae_dx": 0.0015974139096215367,
      "mae_dy": 0.0024014192167669535,
      "pose_mae_dtheta": 0.07063145935535431,
      "pose_mae_dx": 0.02392168715596199,
      "pose_mae_dy": 0.0330946110188961,
      "pose_rmse_dtheta": 0.14273445308208466,
      "pose_rmse_dx": 0.05885631591081619,
      "pose_rmse_dy": 0.08112451434135437,
      "pose_rmse_mean": 0.09423843026161194,
      "rmse_dtheta": 0.020012088119983673,
      "rmse_dx": 0.004701466765254736,
      "rmse_dy": 0.00472464133054018,
      "rmse_mean": 0.0098127331584692,
      "rotation_flip": 0.007209805306047201,
      "sparse_tokens": 32089.0,
      "step": 4526,
      "turn_loss": 0.09561042487621307,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.21032335997026574,
      "grad_norm": 1.3401615619659424,
      "learning_rate": 6.973111843012796e-06,
      "loss": 0.3067,
      "mae_dtheta": 0.04095853865146637,
      "mae_dx": 0.011565382592380047,
      "mae_dy": 0.005506990943104029,
      "pose_mae_dtheta": 0.3519724905490875,
      "pose_mae_dx": 0.07284467667341232,
      "pose_mae_dy": 0.06401989609003067,
      "pose_rmse_dtheta": 0.6281293034553528,
      "pose_rmse_dx": 0.14890623092651367,
      "pose_rmse_dy": 0.1518644243478775,
      "pose_rmse_mean": 0.3096333146095276,
      "rmse_dtheta": 0.06477878987789154,
      "rmse_dx": 0.022557515650987625,
      "rmse_dy": 0.01147401612251997,
      "rmse_mean": 0.03293677419424057,
      "rotation_flip": 0.033898305147886276,
      "sparse_tokens": 2999.0,
      "step": 4527,
      "turn_loss": 0.15559744834899902,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21036981973610852,
      "grad_norm": 0.4512063264846802,
      "learning_rate": 6.971896861720757e-06,
      "loss": 0.0864,
      "mae_dtheta": 0.00878745038062334,
      "mae_dx": 0.0016365126939490438,
      "mae_dy": 0.0020892417524009943,
      "pose_mae_dtheta": 0.06198924034833908,
      "pose_mae_dx": 0.022767407819628716,
      "pose_mae_dy": 0.02724042534828186,
      "pose_rmse_dtheta": 0.16504761576652527,
      "pose_rmse_dx": 0.058300260454416275,
      "pose_rmse_dy": 0.06747963279485703,
      "pose_rmse_mean": 0.09694250673055649,
      "rmse_dtheta": 0.019905932247638702,
      "rmse_dx": 0.005089407321065664,
      "rmse_dy": 0.0047485195100307465,
      "rmse_mean": 0.009914619848132133,
      "rotation_flip": 0.003950834274291992,
      "sparse_tokens": 32089.0,
      "step": 4528,
      "turn_loss": 0.07419340312480927,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16836.0,
      "epoch": 0.2104162795019513,
      "grad_norm": 0.3956894874572754,
      "learning_rate": 6.970681742532911e-06,
      "loss": 0.115,
      "mae_dtheta": 0.02940419316291809,
      "mae_dx": 0.01321876235306263,
      "mae_dy": 0.005579800810664892,
      "pose_mae_dtheta": 0.2075294554233551,
      "pose_mae_dx": 0.09828530997037888,
      "pose_mae_dy": 0.09332219511270523,
      "pose_rmse_dtheta": 0.34962597489356995,
      "pose_rmse_dx": 0.23572956025600433,
      "pose_rmse_dy": 0.19051480293273926,
      "pose_rmse_mean": 0.2586234509944916,
      "rmse_dtheta": 0.044206634163856506,
      "rmse_dx": 0.028018690645694733,
      "rmse_dy": 0.009198050014674664,
      "rmse_mean": 0.02714112401008606,
      "rotation_flip": 0.007621951401233673,
      "sparse_tokens": 13024.0,
      "step": 4529,
      "turn_loss": 0.26928019523620605,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 2632.0,
      "epoch": 0.2104627392677941,
      "grad_norm": 0.9301093220710754,
      "learning_rate": 6.969466485534233e-06,
      "loss": 0.2396,
      "mae_dtheta": 0.05164859816431999,
      "mae_dx": 0.029724925756454468,
      "mae_dy": 0.018282851204276085,
      "pose_mae_dtheta": 0.35660049319267273,
      "pose_mae_dx": 0.14803612232208252,
      "pose_mae_dy": 0.18630628287792206,
      "pose_rmse_dtheta": 0.47893592715263367,
      "pose_rmse_dx": 0.21859142184257507,
      "pose_rmse_dy": 0.2601369321346283,
      "pose_rmse_mean": 0.3192214369773865,
      "rmse_dtheta": 0.06929440796375275,
      "rmse_dx": 0.039844635874032974,
      "rmse_dy": 0.02339746803045273,
      "rmse_mean": 0.044178836047649384,
      "rotation_flip": 0.04273504391312599,
      "sparse_tokens": 2373.0,
      "step": 4530,
      "turn_loss": 0.814961314201355,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21050919903363688,
      "grad_norm": 0.3811367154121399,
      "learning_rate": 6.968251090809708e-06,
      "loss": 0.0822,
      "mae_dtheta": 0.009354285895824432,
      "mae_dx": 0.001369456178508699,
      "mae_dy": 0.0015187575481832027,
      "pose_mae_dtheta": 0.06661753356456757,
      "pose_mae_dx": 0.017492977902293205,
      "pose_mae_dy": 0.025249117985367775,
      "pose_rmse_dtheta": 0.16610199213027954,
      "pose_rmse_dx": 0.0577494241297245,
      "pose_rmse_dy": 0.05997656658291817,
      "pose_rmse_mean": 0.094609335064888,
      "rmse_dtheta": 0.021043136715888977,
      "rmse_dx": 0.005646896548569202,
      "rmse_dy": 0.0031484782230108976,
      "rmse_mean": 0.009946170262992382,
      "rotation_flip": 0.0035955056082457304,
      "sparse_tokens": 32073.0,
      "step": 4531,
      "turn_loss": 0.0585467703640461,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21055565879947966,
      "grad_norm": 0.42244473099708557,
      "learning_rate": 6.967035558444326e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.007163777481764555,
      "mae_dx": 0.003392777405679226,
      "mae_dy": 0.0009058918803930283,
      "pose_mae_dtheta": 0.053079791367053986,
      "pose_mae_dx": 0.030254356563091278,
      "pose_mae_dy": 0.012557015754282475,
      "pose_rmse_dtheta": 0.18919619917869568,
      "pose_rmse_dx": 0.11849159002304077,
      "pose_rmse_dy": 0.032054461538791656,
      "pose_rmse_mean": 0.11324741691350937,
      "rmse_dtheta": 0.02174481190741062,
      "rmse_dx": 0.012121203355491161,
      "rmse_dy": 0.002273897174745798,
      "rmse_mean": 0.012046637944877148,
      "rotation_flip": 0.00431778933852911,
      "sparse_tokens": 32073.0,
      "step": 4532,
      "turn_loss": 0.05882798880338669,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21060211856532243,
      "grad_norm": 0.6663469672203064,
      "learning_rate": 6.965819888523093e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.009608509950339794,
      "mae_dx": 0.0015241443179547787,
      "mae_dy": 0.0018286019330844283,
      "pose_mae_dtheta": 0.06601063162088394,
      "pose_mae_dx": 0.019473586231470108,
      "pose_mae_dy": 0.024907872080802917,
      "pose_rmse_dtheta": 0.19266295433044434,
      "pose_rmse_dx": 0.05649428442120552,
      "pose_rmse_dy": 0.06626313924789429,
      "pose_rmse_mean": 0.10514013469219208,
      "rmse_dtheta": 0.02304396592080593,
      "rmse_dx": 0.005492496304214001,
      "rmse_dy": 0.004151313100010157,
      "rmse_mean": 0.01089592557400465,
      "rotation_flip": 0.0018509948858991265,
      "sparse_tokens": 32089.0,
      "step": 4533,
      "turn_loss": 0.06922581046819687,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2106485783311652,
      "grad_norm": 0.4420977234840393,
      "learning_rate": 6.96460408113102e-06,
      "loss": 0.1365,
      "mae_dtheta": 0.008796164765954018,
      "mae_dx": 0.0014624206814914942,
      "mae_dy": 0.0013381743337959051,
      "pose_mae_dtheta": 0.05713443085551262,
      "pose_mae_dx": 0.01528938114643097,
      "pose_mae_dy": 0.01782788150012493,
      "pose_rmse_dtheta": 0.1670597642660141,
      "pose_rmse_dx": 0.03275834396481514,
      "pose_rmse_dy": 0.047683265060186386,
      "pose_rmse_mean": 0.08250045776367188,
      "rmse_dtheta": 0.023854020982980728,
      "rmse_dx": 0.003915570210665464,
      "rmse_dy": 0.0034902188926935196,
      "rmse_mean": 0.010419937781989574,
      "rotation_flip": 0.0024968788493424654,
      "sparse_tokens": 32185.0,
      "step": 4534,
      "turn_loss": 0.06593445688486099,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.210695038097008,
      "grad_norm": 0.5397343635559082,
      "learning_rate": 6.9633881363531275e-06,
      "loss": 0.1867,
      "mae_dtheta": 0.011693109758198261,
      "mae_dx": 0.002888438757508993,
      "mae_dy": 0.0028981156647205353,
      "pose_mae_dtheta": 0.0885370746254921,
      "pose_mae_dx": 0.039726439863443375,
      "pose_mae_dy": 0.04215870425105095,
      "pose_rmse_dtheta": 0.18555991351604462,
      "pose_rmse_dx": 0.09847446531057358,
      "pose_rmse_dy": 0.09097202867269516,
      "pose_rmse_mean": 0.12500214576721191,
      "rmse_dtheta": 0.023797689005732536,
      "rmse_dx": 0.00896520633250475,
      "rmse_dy": 0.0061351158656179905,
      "rmse_mean": 0.012966005131602287,
      "rotation_flip": 0.0023631351068615913,
      "sparse_tokens": 32089.0,
      "step": 4535,
      "turn_loss": 0.13678529858589172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.21074149786285076,
      "grad_norm": 0.5728866457939148,
      "learning_rate": 6.962172054274449e-06,
      "loss": 0.1769,
      "mae_dtheta": 0.032453503459692,
      "mae_dx": 0.01108153909444809,
      "mae_dy": 0.006711507216095924,
      "pose_mae_dtheta": 0.25362205505371094,
      "pose_mae_dx": 0.09478416293859482,
      "pose_mae_dy": 0.10075058043003082,
      "pose_rmse_dtheta": 0.41185349225997925,
      "pose_rmse_dx": 0.19718684256076813,
      "pose_rmse_dy": 0.21373580396175385,
      "pose_rmse_mean": 0.27425873279571533,
      "rmse_dtheta": 0.047484416514635086,
      "rmse_dx": 0.02380526252090931,
      "rmse_dy": 0.01172596588730812,
      "rmse_mean": 0.02767188474535942,
      "rotation_flip": 0.01184068899601698,
      "sparse_tokens": 18357.0,
      "step": 4536,
      "turn_loss": 0.30343931913375854,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21078795762869354,
      "grad_norm": 0.4595508277416229,
      "learning_rate": 6.960955834980028e-06,
      "loss": 0.1358,
      "mae_dtheta": 0.013368644751608372,
      "mae_dx": 0.0026748627424240112,
      "mae_dy": 0.002808269811794162,
      "pose_mae_dtheta": 0.08829046785831451,
      "pose_mae_dx": 0.034513816237449646,
      "pose_mae_dy": 0.04109586030244827,
      "pose_rmse_dtheta": 0.21193154156208038,
      "pose_rmse_dx": 0.0935123860836029,
      "pose_rmse_dy": 0.11637847870588303,
      "pose_rmse_mean": 0.14060747623443604,
      "rmse_dtheta": 0.028559906408190727,
      "rmse_dx": 0.008367054164409637,
      "rmse_dy": 0.006968597415834665,
      "rmse_mean": 0.014631854370236397,
      "rotation_flip": 0.005971337668597698,
      "sparse_tokens": 32089.0,
      "step": 4537,
      "turn_loss": 0.13535094261169434,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21083441739453634,
      "grad_norm": 0.4817195534706116,
      "learning_rate": 6.959739478554912e-06,
      "loss": 0.1341,
      "mae_dtheta": 0.013538354076445103,
      "mae_dx": 0.002144215162843466,
      "mae_dy": 0.0025269899051636457,
      "pose_mae_dtheta": 0.09470625221729279,
      "pose_mae_dx": 0.022992586717009544,
      "pose_mae_dy": 0.0274531040340662,
      "pose_rmse_dtheta": 0.2623608112335205,
      "pose_rmse_dx": 0.05664360523223877,
      "pose_rmse_dy": 0.05799936130642891,
      "pose_rmse_mean": 0.12566792964935303,
      "rmse_dtheta": 0.030235188081860542,
      "rmse_dx": 0.006276294123381376,
      "rmse_dy": 0.005350653547793627,
      "rmse_mean": 0.013954045251011848,
      "rotation_flip": 0.0051587303169071674,
      "sparse_tokens": 32105.0,
      "step": 4538,
      "turn_loss": 0.10365830361843109,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.21088087716037912,
      "grad_norm": 0.4213358759880066,
      "learning_rate": 6.958522985084161e-06,
      "loss": 0.1427,
      "mae_dtheta": 0.015841670334339142,
      "mae_dx": 0.003216000972315669,
      "mae_dy": 0.00428449921309948,
      "pose_mae_dtheta": 0.112557053565979,
      "pose_mae_dx": 0.033880703151226044,
      "pose_mae_dy": 0.03952300548553467,
      "pose_rmse_dtheta": 0.21869029104709625,
      "pose_rmse_dx": 0.07488386332988739,
      "pose_rmse_dy": 0.08204159885644913,
      "pose_rmse_mean": 0.12520524859428406,
      "rmse_dtheta": 0.028098857030272484,
      "rmse_dx": 0.00779402581974864,
      "rmse_dy": 0.008665005676448345,
      "rmse_mean": 0.014852629974484444,
      "rotation_flip": 0.008381688967347145,
      "sparse_tokens": 32153.0,
      "step": 4539,
      "turn_loss": 0.1574431210756302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2109273369262219,
      "grad_norm": 0.46410802006721497,
      "learning_rate": 6.957306354652848e-06,
      "loss": 0.1137,
      "mae_dtheta": 0.0063354638405144215,
      "mae_dx": 0.001134325168095529,
      "mae_dy": 0.0012349161552265286,
      "pose_mae_dtheta": 0.04226760193705559,
      "pose_mae_dx": 0.01566857472062111,
      "pose_mae_dy": 0.017555713653564453,
      "pose_rmse_dtheta": 0.11350768059492111,
      "pose_rmse_dx": 0.041174568235874176,
      "pose_rmse_dy": 0.04684879630804062,
      "pose_rmse_mean": 0.06717702001333237,
      "rmse_dtheta": 0.017125794664025307,
      "rmse_dx": 0.0041121831163764,
      "rmse_dy": 0.0028769506607204676,
      "rmse_mean": 0.008038309402763844,
      "rotation_flip": 0.0,
      "sparse_tokens": 32041.0,
      "step": 4540,
      "turn_loss": 0.04635965824127197,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.21097379669206467,
      "grad_norm": 0.6200400590896606,
      "learning_rate": 6.95608958734605e-06,
      "loss": 0.1732,
      "mae_dtheta": 0.04077386111021042,
      "mae_dx": 0.015479077585041523,
      "mae_dy": 0.00688402634114027,
      "pose_mae_dtheta": 0.3188916742801666,
      "pose_mae_dx": 0.11287764459848404,
      "pose_mae_dy": 0.07204177975654602,
      "pose_rmse_dtheta": 0.5798879861831665,
      "pose_rmse_dx": 0.2316768765449524,
      "pose_rmse_dy": 0.16653837263584137,
      "pose_rmse_mean": 0.32603442668914795,
      "rmse_dtheta": 0.0606975294649601,
      "rmse_dx": 0.027560336515307426,
      "rmse_dy": 0.01408225018531084,
      "rmse_mean": 0.03411337360739708,
      "rotation_flip": 0.014760147780179977,
      "sparse_tokens": 14580.0,
      "step": 4541,
      "turn_loss": 0.2604002058506012,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.21102025645790745,
      "grad_norm": 0.37147533893585205,
      "learning_rate": 6.954872683248857e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.009165672585368156,
      "mae_dx": 0.0018924736650660634,
      "mae_dy": 0.0028400938026607037,
      "pose_mae_dtheta": 0.0653124451637268,
      "pose_mae_dx": 0.02853909507393837,
      "pose_mae_dy": 0.02930763177573681,
      "pose_rmse_dtheta": 0.14496947824954987,
      "pose_rmse_dx": 0.08125033974647522,
      "pose_rmse_dy": 0.07020062208175659,
      "pose_rmse_mean": 0.09880682080984116,
      "rmse_dtheta": 0.020022328943014145,
      "rmse_dx": 0.005184740759432316,
      "rmse_dy": 0.006852676160633564,
      "rmse_mean": 0.010686581954360008,
      "rotation_flip": 0.0040797824040055275,
      "sparse_tokens": 32057.0,
      "step": 4542,
      "turn_loss": 0.08894266933202744,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32663.0,
      "epoch": 0.21106671622375023,
      "grad_norm": 0.3942855894565582,
      "learning_rate": 6.953655642446368e-06,
      "loss": 0.1258,
      "mae_dtheta": 0.039827439934015274,
      "mae_dx": 0.014070689678192139,
      "mae_dy": 0.006978737656027079,
      "pose_mae_dtheta": 0.3152841627597809,
      "pose_mae_dx": 0.11031480133533478,
      "pose_mae_dy": 0.08501951396465302,
      "pose_rmse_dtheta": 0.5308152437210083,
      "pose_rmse_dx": 0.2365756630897522,
      "pose_rmse_dy": 0.19328047335147858,
      "pose_rmse_mean": 0.3202238082885742,
      "rmse_dtheta": 0.05861657112836838,
      "rmse_dx": 0.02683885022997856,
      "rmse_dy": 0.013862150721251965,
      "rmse_mean": 0.03310585767030716,
      "rotation_flip": 0.01882210001349449,
      "sparse_tokens": 25682.0,
      "step": 4543,
      "turn_loss": 0.31413182616233826,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 16836.0,
      "epoch": 0.211113175989593,
      "grad_norm": 0.652483344078064,
      "learning_rate": 6.952438465023693e-06,
      "loss": 0.1656,
      "mae_dtheta": 0.03273031488060951,
      "mae_dx": 0.013094304129481316,
      "mae_dy": 0.005486816633492708,
      "pose_mae_dtheta": 0.23915529251098633,
      "pose_mae_dx": 0.11462021619081497,
      "pose_mae_dy": 0.07782838493585587,
      "pose_rmse_dtheta": 0.4240683615207672,
      "pose_rmse_dx": 0.2570139765739441,
      "pose_rmse_dy": 0.16456055641174316,
      "pose_rmse_mean": 0.2818809747695923,
      "rmse_dtheta": 0.04995841905474663,
      "rmse_dx": 0.02655278891324997,
      "rmse_dy": 0.009561245329678059,
      "rmse_mean": 0.028690818697214127,
      "rotation_flip": 0.014531043358147144,
      "sparse_tokens": 12905.0,
      "step": 4544,
      "turn_loss": 0.2805647850036621,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21115963575543578,
      "grad_norm": 0.693051278591156,
      "learning_rate": 6.951221151065948e-06,
      "loss": 0.1548,
      "mae_dtheta": 0.008965173736214638,
      "mae_dx": 0.0020254268310964108,
      "mae_dy": 0.0019441789481788874,
      "pose_mae_dtheta": 0.061172716319561005,
      "pose_mae_dx": 0.026058733463287354,
      "pose_mae_dy": 0.024444784969091415,
      "pose_rmse_dtheta": 0.17781004309654236,
      "pose_rmse_dx": 0.07926078885793686,
      "pose_rmse_dy": 0.06499704718589783,
      "pose_rmse_mean": 0.10735596716403961,
      "rmse_dtheta": 0.02177431806921959,
      "rmse_dx": 0.007617298047989607,
      "rmse_dy": 0.004387889057397842,
      "rmse_mean": 0.011259835213422775,
      "rotation_flip": 0.0042372881434857845,
      "sparse_tokens": 32073.0,
      "step": 4545,
      "turn_loss": 0.0776766836643219,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.2112060955212786,
      "grad_norm": 0.5029288530349731,
      "learning_rate": 6.95000370065826e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.02917374297976494,
      "mae_dx": 0.010611669160425663,
      "mae_dy": 0.0068964059464633465,
      "pose_mae_dtheta": 0.2128041386604309,
      "pose_mae_dx": 0.08042153716087341,
      "pose_mae_dy": 0.0717616081237793,
      "pose_rmse_dtheta": 0.37999528646469116,
      "pose_rmse_dx": 0.19384871423244476,
      "pose_rmse_dy": 0.15518707036972046,
      "pose_rmse_mean": 0.24301037192344666,
      "rmse_dtheta": 0.04617016762495041,
      "rmse_dx": 0.02288801595568657,
      "rmse_dy": 0.013490119948983192,
      "rmse_mean": 0.02751610055565834,
      "rotation_flip": 0.023664122447371483,
      "sparse_tokens": 23543.0,
      "step": 4546,
      "turn_loss": 0.26414817571640015,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.21125255528712136,
      "grad_norm": 0.5068799257278442,
      "learning_rate": 6.948786113885766e-06,
      "loss": 0.1405,
      "mae_dtheta": 0.03393145278096199,
      "mae_dx": 0.010490033775568008,
      "mae_dy": 0.00416741706430912,
      "pose_mae_dtheta": 0.2666434347629547,
      "pose_mae_dx": 0.07404474169015884,
      "pose_mae_dy": 0.04117928817868233,
      "pose_rmse_dtheta": 0.46599432826042175,
      "pose_rmse_dx": 0.17048756778240204,
      "pose_rmse_dy": 0.1075577363371849,
      "pose_rmse_mean": 0.2480131983757019,
      "rmse_dtheta": 0.05164638161659241,
      "rmse_dx": 0.022367820143699646,
      "rmse_dy": 0.009159695357084274,
      "rmse_mean": 0.02772463485598564,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 18271.0,
      "step": 4547,
      "turn_loss": 0.2669295370578766,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21129901505296414,
      "grad_norm": 0.3830139636993408,
      "learning_rate": 6.9475683908336135e-06,
      "loss": 0.0826,
      "mae_dtheta": 0.010817551985383034,
      "mae_dx": 0.002284236019477248,
      "mae_dy": 0.0027994122356176376,
      "pose_mae_dtheta": 0.07296586781740189,
      "pose_mae_dx": 0.029117401689291,
      "pose_mae_dy": 0.028770238161087036,
      "pose_rmse_dtheta": 0.18933114409446716,
      "pose_rmse_dx": 0.0800820142030716,
      "pose_rmse_dy": 0.07481503486633301,
      "pose_rmse_mean": 0.11474274098873138,
      "rmse_dtheta": 0.02495947666466236,
      "rmse_dx": 0.006450767628848553,
      "rmse_dy": 0.006818994414061308,
      "rmse_mean": 0.012743080034852028,
      "rotation_flip": 0.001856148475781083,
      "sparse_tokens": 32073.0,
      "step": 4548,
      "turn_loss": 0.08674100786447525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.21134547481880692,
      "grad_norm": 0.5653092861175537,
      "learning_rate": 6.946350531586959e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.03417258709669113,
      "mae_dx": 0.011628441512584686,
      "mae_dy": 0.004591323900967836,
      "pose_mae_dtheta": 0.2525245249271393,
      "pose_mae_dx": 0.08596599847078323,
      "pose_mae_dy": 0.046408992260694504,
      "pose_rmse_dtheta": 0.4216417670249939,
      "pose_rmse_dx": 0.1903083622455597,
      "pose_rmse_dy": 0.10175146162509918,
      "pose_rmse_mean": 0.2379005402326584,
      "rmse_dtheta": 0.049285415560007095,
      "rmse_dx": 0.0236513614654541,
      "rmse_dy": 0.00889424979686737,
      "rmse_mean": 0.027277007699012756,
      "rotation_flip": 0.017910446971654892,
      "sparse_tokens": 11161.0,
      "step": 4549,
      "turn_loss": 0.22892461717128754,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.2113919345846497,
      "grad_norm": 0.9655483961105347,
      "learning_rate": 6.945132536230965e-06,
      "loss": 0.302,
      "mae_dtheta": 0.0368645116686821,
      "mae_dx": 0.010764527134597301,
      "mae_dy": 0.005743751768022776,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9655482769012451,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 164.5878143310547,
      "model/head/act_norm_mean": 101.5721240942029,
      "model/head/act_norm_min": 64.0143814086914,
      "model/head/act_over_embed": 69.8013146107442,
      "model/head/grad_frac": 0.12345214933156967,
      "model/head/grad_norm": 0.1191990077495575,
      "model/head/grad_zero_frac": 0.00017100948025472462,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6809329710144928,
      "model/head/update_ratio": 0.002044576220214367,
      "model/head/weight_delta": 7.940154075622559,
      "model/head/weight_delta_rel": 0.1392938196659088,
      "model/head/weight_norm": 58.300106048583984,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4190504848957062,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4189671925136021,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.418904572725296,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2879181771280026,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12040667235851288,
      "model/modality_embedder.encoders.pose/grad_norm": 0.11625845730304718,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5348493303571429,
      "model/modality_embedder.encoders.pose/update_ratio": 0.003762764623388648,
      "model/modality_embedder.encoders.pose/weight_delta": 2.6021528244018555,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08502044528722763,
      "model/modality_embedder.encoders.pose/weight_norm": 30.897085189819336,
      "model/modality_embedder/grad_frac": 0.12040667235851288,
      "model/modality_embedder/grad_norm": 0.11625845730304718,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5348493303571429,
      "model/modality_embedder/update_ratio": 0.003762764623388648,
      "model/modality_embedder/weight_delta": 2.6021528244018555,
      "model/modality_embedder/weight_delta_rel": 0.08502044528722763,
      "model/modality_embedder/weight_norm": 30.897085189819336,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.32595825195312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.777914366229584,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.124258995056152,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.653196002667078,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11833636462688446,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.11425947397947311,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.004112530034035444,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.9159185886383057,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.06981723010540009,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.78325653076172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.80250549316406,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.642824792960663,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.933881759643555,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.24757054533567,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10997013747692108,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.10618147999048233,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.003602242097258568,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.4236772060394287,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08395807445049286,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.476497650146484,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.12824249267578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.301820939728547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.233846664428711,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.38764822916119,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09580095112323761,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.09250044077634811,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.003039727685973048,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.604050874710083,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0874391496181488,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.43050193786621,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.11067962646484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.276934883252817,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.021171569824219,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.744965022459144,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09165208786725998,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08849451690912247,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002977214753627777,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.2221791744232178,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07594353705644608,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.723928451538086,
      "model/normalizer/grad_frac": 0.3430849313735962,
      "model/normalizer/grad_norm": 0.33126506209373474,
      "model/normalizer/grad_zero_frac": 0.0001654433726798743,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004229210317134857,
      "model/normalizer/weight_delta": 4.71915864944458,
      "model/normalizer/weight_delta_rel": 0.060780029743909836,
      "model/normalizer/weight_norm": 78.32787322998047,
      "pose_mae_dtheta": 0.28424203395843506,
      "pose_mae_dx": 0.0811883732676506,
      "pose_mae_dy": 0.05772693082690239,
      "pose_rmse_dtheta": 0.5241603851318359,
      "pose_rmse_dx": 0.19612768292427063,
      "pose_rmse_dy": 0.1296570599079132,
      "pose_rmse_mean": 0.2833150327205658,
      "rmse_dtheta": 0.054965436458587646,
      "rmse_dx": 0.022109802812337875,
      "rmse_dy": 0.01238989643752575,
      "rmse_mean": 0.029821714386343956,
      "rotation_flip": 0.014953271485865116,
      "sparse_tokens": 17465.0,
      "step": 4550,
      "turn_loss": 0.284071683883667,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.21143839435049247,
      "grad_norm": 0.6924110651016235,
      "learning_rate": 6.943914404850811e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.03666817024350166,
      "mae_dx": 0.01812976412475109,
      "mae_dy": 0.005852810572832823,
      "pose_mae_dtheta": 0.3005514442920685,
      "pose_mae_dx": 0.15246526896953583,
      "pose_mae_dy": 0.07615756243467331,
      "pose_rmse_dtheta": 0.46865415573120117,
      "pose_rmse_dx": 0.2999923825263977,
      "pose_rmse_dy": 0.15832625329494476,
      "pose_rmse_mean": 0.3089909553527832,
      "rmse_dtheta": 0.05035535246133804,
      "rmse_dx": 0.03136502951383591,
      "rmse_dy": 0.010505150072276592,
      "rmse_mean": 0.030741844326257706,
      "rotation_flip": 0.021677661687135696,
      "sparse_tokens": 19450.0,
      "step": 4551,
      "turn_loss": 0.28802865743637085,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 1658.0,
      "epoch": 0.21148485411633525,
      "grad_norm": 0.5739942789077759,
      "learning_rate": 6.942696137531678e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.033472687005996704,
      "mae_dx": 0.012669687159359455,
      "mae_dy": 0.003058450296521187,
      "pose_mae_dtheta": 0.2714936435222626,
      "pose_mae_dx": 0.1258314698934555,
      "pose_mae_dy": 0.02821572870016098,
      "pose_rmse_dtheta": 0.4358483552932739,
      "pose_rmse_dx": 0.2983611226081848,
      "pose_rmse_dy": 0.03995329514145851,
      "pose_rmse_mean": 0.258054256439209,
      "rmse_dtheta": 0.04783063009381294,
      "rmse_dx": 0.0257461778819561,
      "rmse_dy": 0.005910161882638931,
      "rmse_mean": 0.02649565599858761,
      "rotation_flip": 0.016129031777381897,
      "sparse_tokens": 1367.0,
      "step": 4552,
      "turn_loss": 0.3182043135166168,
      "turns": 5.0,
      "turns_per_sample": 5.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21153131388217802,
      "grad_norm": 0.6012962460517883,
      "learning_rate": 6.941477734358763e-06,
      "loss": 0.2041,
      "mae_dtheta": 0.009039221331477165,
      "mae_dx": 0.00213454058393836,
      "mae_dy": 0.0025200345553457737,
      "pose_mae_dtheta": 0.0649820938706398,
      "pose_mae_dx": 0.026744261384010315,
      "pose_mae_dy": 0.02740112505853176,
      "pose_rmse_dtheta": 0.16697002947330475,
      "pose_rmse_dx": 0.07684691250324249,
      "pose_rmse_dy": 0.06890816986560822,
      "pose_rmse_mean": 0.10424171388149261,
      "rmse_dtheta": 0.02130160480737686,
      "rmse_dx": 0.00637269439175725,
      "rmse_dy": 0.005804968066513538,
      "rmse_mean": 0.011159755289554596,
      "rotation_flip": 0.006454587448388338,
      "sparse_tokens": 32089.0,
      "step": 4553,
      "turn_loss": 0.08876817673444748,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.2115777736480208,
      "grad_norm": 0.5427291393280029,
      "learning_rate": 6.940259195417265e-06,
      "loss": 0.1449,
      "mae_dtheta": 0.029230322688817978,
      "mae_dx": 0.011336172930896282,
      "mae_dy": 0.006039904896169901,
      "pose_mae_dtheta": 0.20942111313343048,
      "pose_mae_dx": 0.09121335297822952,
      "pose_mae_dy": 0.07357776910066605,
      "pose_rmse_dtheta": 0.4092690944671631,
      "pose_rmse_dx": 0.21712972223758698,
      "pose_rmse_dy": 0.17938794195652008,
      "pose_rmse_mean": 0.2685955762863159,
      "rmse_dtheta": 0.04708264023065567,
      "rmse_dx": 0.02445468120276928,
      "rmse_dy": 0.013879458419978619,
      "rmse_mean": 0.028472259640693665,
      "rotation_flip": 0.010389610193669796,
      "sparse_tokens": 14345.0,
      "step": 4554,
      "turn_loss": 0.24088583886623383,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2116242334138636,
      "grad_norm": 0.4698162078857422,
      "learning_rate": 6.9390405207924014e-06,
      "loss": 0.1004,
      "mae_dtheta": 0.010755752213299274,
      "mae_dx": 0.0020300461910665035,
      "mae_dy": 0.0026790692936629057,
      "pose_mae_dtheta": 0.06833167374134064,
      "pose_mae_dx": 0.025715861469507217,
      "pose_mae_dy": 0.028972530737519264,
      "pose_rmse_dtheta": 0.15589174628257751,
      "pose_rmse_dx": 0.07164667546749115,
      "pose_rmse_dy": 0.07133718580007553,
      "pose_rmse_mean": 0.09962520003318787,
      "rmse_dtheta": 0.022318711504340172,
      "rmse_dx": 0.00645748944953084,
      "rmse_dy": 0.005720255896449089,
      "rmse_mean": 0.01149881910532713,
      "rotation_flip": 0.0033585221972316504,
      "sparse_tokens": 32073.0,
      "step": 4555,
      "turn_loss": 0.0878835916519165,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.21167069317970638,
      "grad_norm": 0.8641304969787598,
      "learning_rate": 6.937821710569394e-06,
      "loss": 0.2263,
      "mae_dtheta": 0.02712465077638626,
      "mae_dx": 0.010943957604467869,
      "mae_dy": 0.004261726513504982,
      "pose_mae_dtheta": 0.19221732020378113,
      "pose_mae_dx": 0.09902464598417282,
      "pose_mae_dy": 0.05989467725157738,
      "pose_rmse_dtheta": 0.34459754824638367,
      "pose_rmse_dx": 0.24119563400745392,
      "pose_rmse_dy": 0.12923665344715118,
      "pose_rmse_mean": 0.23834328353405,
      "rmse_dtheta": 0.04305969178676605,
      "rmse_dx": 0.023939020931720734,
      "rmse_dy": 0.008130507543683052,
      "rmse_mean": 0.025043074041604996,
      "rotation_flip": 0.01228733453899622,
      "sparse_tokens": 18724.0,
      "step": 4556,
      "turn_loss": 0.22962331771850586,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.21171715294554916,
      "grad_norm": 0.44474396109580994,
      "learning_rate": 6.9366027648334746e-06,
      "loss": 0.1148,
      "mae_dtheta": 0.04570331051945686,
      "mae_dx": 0.008642149157822132,
      "mae_dy": 0.0062462580390274525,
      "pose_mae_dtheta": 0.38621991872787476,
      "pose_mae_dx": 0.07494223862886429,
      "pose_mae_dy": 0.05400696024298668,
      "pose_rmse_dtheta": 0.6278226971626282,
      "pose_rmse_dx": 0.18146532773971558,
      "pose_rmse_dy": 0.14506052434444427,
      "pose_rmse_mean": 0.3181161880493164,
      "rmse_dtheta": 0.06628730148077011,
      "rmse_dx": 0.018740631639957428,
      "rmse_dy": 0.016782570630311966,
      "rmse_mean": 0.03393683582544327,
      "rotation_flip": 0.02355460450053215,
      "sparse_tokens": 7156.0,
      "step": 4557,
      "turn_loss": 0.31373581290245056,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.21176361271139194,
      "grad_norm": 0.6073082089424133,
      "learning_rate": 6.935383683669884e-06,
      "loss": 0.109,
      "mae_dtheta": 0.010635077953338623,
      "mae_dx": 0.002292719902470708,
      "mae_dy": 0.003206792986020446,
      "pose_mae_dtheta": 0.07140714675188065,
      "pose_mae_dx": 0.02973291464149952,
      "pose_mae_dy": 0.032951947301626205,
      "pose_rmse_dtheta": 0.144804447889328,
      "pose_rmse_dx": 0.07139690965414047,
      "pose_rmse_dy": 0.06818535923957825,
      "pose_rmse_mean": 0.0947955772280693,
      "rmse_dtheta": 0.019556067883968353,
      "rmse_dx": 0.00638393871486187,
      "rmse_dy": 0.006474372465163469,
      "rmse_mean": 0.010804793797433376,
      "rotation_flip": 0.0042721000500023365,
      "sparse_tokens": 32121.0,
      "step": 4558,
      "turn_loss": 0.0864376425743103,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.2118100724772347,
      "grad_norm": 1.1410664319992065,
      "learning_rate": 6.934164467163873e-06,
      "loss": 0.1984,
      "mae_dtheta": 0.03477511554956436,
      "mae_dx": 0.009713658131659031,
      "mae_dy": 0.007048000115901232,
      "pose_mae_dtheta": 0.24852286279201508,
      "pose_mae_dx": 0.06887292116880417,
      "pose_mae_dy": 0.07248006761074066,
      "pose_rmse_dtheta": 0.47036251425743103,
      "pose_rmse_dx": 0.1500224769115448,
      "pose_rmse_dy": 0.18269699811935425,
      "pose_rmse_mean": 0.26769399642944336,
      "rmse_dtheta": 0.055647462606430054,
      "rmse_dx": 0.019873160868883133,
      "rmse_dy": 0.015487369149923325,
      "rmse_mean": 0.03033599816262722,
      "rotation_flip": 0.01193317398428917,
      "sparse_tokens": 7315.0,
      "step": 4559,
      "turn_loss": 0.262988805770874,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.2118565322430775,
      "grad_norm": 0.43264320492744446,
      "learning_rate": 6.932945115400703e-06,
      "loss": 0.0967,
      "mae_dtheta": 0.028652336448431015,
      "mae_dx": 0.008708897978067398,
      "mae_dy": 0.005208796821534634,
      "pose_mae_dtheta": 0.21775758266448975,
      "pose_mae_dx": 0.0850883275270462,
      "pose_mae_dy": 0.087519071996212,
      "pose_rmse_dtheta": 0.38082456588745117,
      "pose_rmse_dx": 0.19015468657016754,
      "pose_rmse_dy": 0.19347324967384338,
      "pose_rmse_mean": 0.25481748580932617,
      "rmse_dtheta": 0.044215988367795944,
      "rmse_dx": 0.020902452990412712,
      "rmse_dy": 0.009236472658813,
      "rmse_mean": 0.02478497102856636,
      "rotation_flip": 0.02063492126762867,
      "sparse_tokens": 13257.0,
      "step": 4560,
      "turn_loss": 0.2209654599428177,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.21190299200892027,
      "grad_norm": 0.3807520270347595,
      "learning_rate": 6.931725628465643e-06,
      "loss": 0.0729,
      "mae_dtheta": 0.012759561650454998,
      "mae_dx": 0.0019472973654046655,
      "mae_dy": 0.0027398369275033474,
      "pose_mae_dtheta": 0.08537396043539047,
      "pose_mae_dx": 0.025325259193778038,
      "pose_mae_dy": 0.028962884098291397,
      "pose_rmse_dtheta": 0.21897923946380615,
      "pose_rmse_dx": 0.05595305934548378,
      "pose_rmse_dy": 0.06557416915893555,
      "pose_rmse_mean": 0.11350215971469879,
      "rmse_dtheta": 0.02673754096031189,
      "rmse_dx": 0.005017358344048262,
      "rmse_dy": 0.005691469181329012,
      "rmse_mean": 0.01248212344944477,
      "rotation_flip": 0.006273963022977114,
      "sparse_tokens": 32153.0,
      "step": 4561,
      "turn_loss": 0.10084336251020432,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.21194945177476304,
      "grad_norm": 0.8810325264930725,
      "learning_rate": 6.930506006443975e-06,
      "loss": 0.1703,
      "mae_dtheta": 0.04861126095056534,
      "mae_dx": 0.010696365498006344,
      "mae_dy": 0.003568578278645873,
      "pose_mae_dtheta": 0.3792745769023895,
      "pose_mae_dx": 0.0748928114771843,
      "pose_mae_dy": 0.038880717009305954,
      "pose_rmse_dtheta": 0.6851862072944641,
      "pose_rmse_dx": 0.17224787175655365,
      "pose_rmse_dy": 0.09748078137636185,
      "pose_rmse_mean": 0.31830495595932007,
      "rmse_dtheta": 0.0708794891834259,
      "rmse_dx": 0.02259572222828865,
      "rmse_dy": 0.008053751662373543,
      "rmse_mean": 0.033842988312244415,
      "rotation_flip": 0.011055276729166508,
      "sparse_tokens": 15610.0,
      "step": 4562,
      "turn_loss": 0.3005423843860626,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21199591154060585,
      "grad_norm": 0.5433893203735352,
      "learning_rate": 6.929286249420983e-06,
      "loss": 0.1267,
      "mae_dtheta": 0.011896721087396145,
      "mae_dx": 0.0023281320463865995,
      "mae_dy": 0.0037348519545048475,
      "pose_mae_dtheta": 0.07919717580080032,
      "pose_mae_dx": 0.026732251048088074,
      "pose_mae_dy": 0.03410694748163223,
      "pose_rmse_dtheta": 0.18728801608085632,
      "pose_rmse_dx": 0.06640074402093887,
      "pose_rmse_dy": 0.07194740325212479,
      "pose_rmse_mean": 0.10854538530111313,
      "rmse_dtheta": 0.023875344544649124,
      "rmse_dx": 0.006333786062896252,
      "rmse_dy": 0.007895635440945625,
      "rmse_mean": 0.012701588682830334,
      "rotation_flip": 0.0034548945259302855,
      "sparse_tokens": 32089.0,
      "step": 4563,
      "turn_loss": 0.14143148064613342,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21204237130644862,
      "grad_norm": 0.44700750708580017,
      "learning_rate": 6.928066357481971e-06,
      "loss": 0.1147,
      "mae_dtheta": 0.011210069991648197,
      "mae_dx": 0.0019716958049684763,
      "mae_dy": 0.0028282832354307175,
      "pose_mae_dtheta": 0.0800730288028717,
      "pose_mae_dx": 0.027773980051279068,
      "pose_mae_dy": 0.028791477903723717,
      "pose_rmse_dtheta": 0.19996337592601776,
      "pose_rmse_dx": 0.0728929340839386,
      "pose_rmse_dy": 0.06993593275547028,
      "pose_rmse_mean": 0.11426407098770142,
      "rmse_dtheta": 0.02461904101073742,
      "rmse_dx": 0.005924021825194359,
      "rmse_dy": 0.006215509958565235,
      "rmse_mean": 0.01225285790860653,
      "rotation_flip": 0.0034246575087308884,
      "sparse_tokens": 32073.0,
      "step": 4564,
      "turn_loss": 0.09244415909051895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.2120888310722914,
      "grad_norm": 0.49556535482406616,
      "learning_rate": 6.9268463307122425e-06,
      "loss": 0.1471,
      "mae_dtheta": 0.03764728829264641,
      "mae_dx": 0.011273694224655628,
      "mae_dy": 0.004771105479449034,
      "pose_mae_dtheta": 0.3120553493499756,
      "pose_mae_dx": 0.09267404675483704,
      "pose_mae_dy": 0.06645981967449188,
      "pose_rmse_dtheta": 0.512921929359436,
      "pose_rmse_dx": 0.20360328257083893,
      "pose_rmse_dy": 0.15035954117774963,
      "pose_rmse_mean": 0.28896158933639526,
      "rmse_dtheta": 0.054241620004177094,
      "rmse_dx": 0.022844279184937477,
      "rmse_dy": 0.008877883665263653,
      "rmse_mean": 0.028654593974351883,
      "rotation_flip": 0.01005025114864111,
      "sparse_tokens": 17741.0,
      "step": 4565,
      "turn_loss": 0.2922145426273346,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21213529083813418,
      "grad_norm": 0.43875449895858765,
      "learning_rate": 6.925626169197115e-06,
      "loss": 0.1337,
      "mae_dtheta": 0.011253755539655685,
      "mae_dx": 0.0017943731509149075,
      "mae_dy": 0.0032281181775033474,
      "pose_mae_dtheta": 0.07864131033420563,
      "pose_mae_dx": 0.02765781618654728,
      "pose_mae_dy": 0.0374583899974823,
      "pose_rmse_dtheta": 0.14901600778102875,
      "pose_rmse_dx": 0.07270576804876328,
      "pose_rmse_dy": 0.07892593741416931,
      "pose_rmse_mean": 0.10021590441465378,
      "rmse_dtheta": 0.020532995462417603,
      "rmse_dx": 0.00488698948174715,
      "rmse_dy": 0.00638603325933218,
      "rmse_mean": 0.010602006688714027,
      "rotation_flip": 0.0039511495269834995,
      "sparse_tokens": 32089.0,
      "step": 4566,
      "turn_loss": 0.09342947602272034,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21218175060397695,
      "grad_norm": 0.39302685856819153,
      "learning_rate": 6.9244058730219176e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.011331855319440365,
      "mae_dx": 0.002073056995868683,
      "mae_dy": 0.002204345539212227,
      "pose_mae_dtheta": 0.0763021782040596,
      "pose_mae_dx": 0.027306606993079185,
      "pose_mae_dy": 0.0264279805123806,
      "pose_rmse_dtheta": 0.1824871003627777,
      "pose_rmse_dx": 0.07716100662946701,
      "pose_rmse_dy": 0.06614930927753448,
      "pose_rmse_mean": 0.10859914869070053,
      "rmse_dtheta": 0.025431454181671143,
      "rmse_dx": 0.006434077396988869,
      "rmse_dy": 0.004959501326084137,
      "rmse_mean": 0.012275010347366333,
      "rotation_flip": 0.004415897186845541,
      "sparse_tokens": 32105.0,
      "step": 4567,
      "turn_loss": 0.08718041330575943,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.21222821036981973,
      "grad_norm": 0.5012511610984802,
      "learning_rate": 6.9231854422719835e-06,
      "loss": 0.1068,
      "mae_dtheta": 0.01521661039441824,
      "mae_dx": 0.0032183981966227293,
      "mae_dy": 0.004942666739225388,
      "pose_mae_dtheta": 0.10281020402908325,
      "pose_mae_dx": 0.03797296807169914,
      "pose_mae_dy": 0.0504264310002327,
      "pose_rmse_dtheta": 0.2361995130777359,
      "pose_rmse_dx": 0.09832288324832916,
      "pose_rmse_dy": 0.12311563640832901,
      "pose_rmse_mean": 0.1525460183620453,
      "rmse_dtheta": 0.029713120311498642,
      "rmse_dx": 0.009165339171886444,
      "rmse_dy": 0.010864494368433952,
      "rmse_mean": 0.016580983996391296,
      "rotation_flip": 0.006805035751312971,
      "sparse_tokens": 32057.0,
      "step": 4568,
      "turn_loss": 0.14023137092590332,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.2122746701356625,
      "grad_norm": 0.5982998013496399,
      "learning_rate": 6.921964877032659e-06,
      "loss": 0.1014,
      "mae_dtheta": 0.05434279516339302,
      "mae_dx": 0.013937396928668022,
      "mae_dy": 0.003450999269261956,
      "pose_mae_dtheta": 0.4127325415611267,
      "pose_mae_dx": 0.12395547330379486,
      "pose_mae_dy": 0.052969012409448624,
      "pose_rmse_dtheta": 0.7372153997421265,
      "pose_rmse_dx": 0.2802594304084778,
      "pose_rmse_dy": 0.10860440135002136,
      "pose_rmse_mean": 0.37535977363586426,
      "rmse_dtheta": 0.0790252611041069,
      "rmse_dx": 0.028457334265112877,
      "rmse_dy": 0.005993380676954985,
      "rmse_mean": 0.0378253273665905,
      "rotation_flip": 0.006172839552164078,
      "sparse_tokens": 2568.0,
      "step": 4569,
      "turn_loss": 0.42361387610435486,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.21232112990150528,
      "grad_norm": 0.514217734336853,
      "learning_rate": 6.9207441773893e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.031380631029605865,
      "mae_dx": 0.010754834860563278,
      "mae_dy": 0.004913968965411186,
      "pose_mae_dtheta": 0.23288530111312866,
      "pose_mae_dx": 0.08474811166524887,
      "pose_mae_dy": 0.04811352118849754,
      "pose_rmse_dtheta": 0.4569895565509796,
      "pose_rmse_dx": 0.20375792682170868,
      "pose_rmse_dy": 0.12335855513811111,
      "pose_rmse_mean": 0.26136869192123413,
      "rmse_dtheta": 0.05136626586318016,
      "rmse_dx": 0.022847488522529602,
      "rmse_dy": 0.010952973738312721,
      "rmse_mean": 0.028388909995555878,
      "rotation_flip": 0.012155591510236263,
      "sparse_tokens": 20960.0,
      "step": 4570,
      "turn_loss": 0.21065254509449005,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 27904.0,
      "epoch": 0.2123675896673481,
      "grad_norm": 0.6499251127243042,
      "learning_rate": 6.919523343427269e-06,
      "loss": 0.2194,
      "mae_dtheta": 0.03040335513651371,
      "mae_dx": 0.011471820063889027,
      "mae_dy": 0.010592417791485786,
      "pose_mae_dtheta": 0.24654340744018555,
      "pose_mae_dx": 0.09521704912185669,
      "pose_mae_dy": 0.11903796344995499,
      "pose_rmse_dtheta": 0.41796863079071045,
      "pose_rmse_dx": 0.2253461629152298,
      "pose_rmse_dy": 0.24141186475753784,
      "pose_rmse_mean": 0.29490888118743896,
      "rmse_dtheta": 0.04630712792277336,
      "rmse_dx": 0.025406308472156525,
      "rmse_dy": 0.021500101312994957,
      "rmse_mean": 0.03107117861509323,
      "rotation_flip": 0.014683152548968792,
      "sparse_tokens": 22329.0,
      "step": 4571,
      "turn_loss": 0.32942548394203186,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 11021.0,
      "epoch": 0.21241404943319087,
      "grad_norm": 0.6725448966026306,
      "learning_rate": 6.9183023752319415e-06,
      "loss": 0.1362,
      "mae_dtheta": 0.042075373232364655,
      "mae_dx": 0.016408104449510574,
      "mae_dy": 0.0059443265199661255,
      "pose_mae_dtheta": 0.36821192502975464,
      "pose_mae_dx": 0.14661064743995667,
      "pose_mae_dy": 0.07865871489048004,
      "pose_rmse_dtheta": 0.6240522861480713,
      "pose_rmse_dx": 0.3192502558231354,
      "pose_rmse_dy": 0.16266097128391266,
      "pose_rmse_mean": 0.3686544895172119,
      "rmse_dtheta": 0.059992462396621704,
      "rmse_dx": 0.031731437891721725,
      "rmse_dy": 0.010845857672393322,
      "rmse_mean": 0.034189920872449875,
      "rotation_flip": 0.00950570311397314,
      "sparse_tokens": 8596.0,
      "step": 4572,
      "turn_loss": 0.3068810701370239,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.21246050919903364,
      "grad_norm": 0.8324618935585022,
      "learning_rate": 6.917081272888697e-06,
      "loss": 0.2883,
      "mae_dtheta": 0.027790840715169907,
      "mae_dx": 0.011887497268617153,
      "mae_dy": 0.005427149590104818,
      "pose_mae_dtheta": 0.20171022415161133,
      "pose_mae_dx": 0.11063767224550247,
      "pose_mae_dy": 0.05491942539811134,
      "pose_rmse_dtheta": 0.34608137607574463,
      "pose_rmse_dx": 0.2582772970199585,
      "pose_rmse_dy": 0.11519847065210342,
      "pose_rmse_mean": 0.2398523986339569,
      "rmse_dtheta": 0.04199468344449997,
      "rmse_dx": 0.02467016875743866,
      "rmse_dy": 0.010522760450839996,
      "rmse_mean": 0.025729205459356308,
      "rotation_flip": 0.01011122390627861,
      "sparse_tokens": 18188.0,
      "step": 4573,
      "turn_loss": 0.233907550573349,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.21250696896487642,
      "grad_norm": 0.9847956895828247,
      "learning_rate": 6.915860036482931e-06,
      "loss": 0.3626,
      "mae_dtheta": 0.040323656052351,
      "mae_dx": 0.011711012572050095,
      "mae_dy": 0.009423880837857723,
      "pose_mae_dtheta": 0.31621283292770386,
      "pose_mae_dx": 0.0903332531452179,
      "pose_mae_dy": 0.07666300982236862,
      "pose_rmse_dtheta": 0.5484614372253418,
      "pose_rmse_dx": 0.19773387908935547,
      "pose_rmse_dy": 0.20454902946949005,
      "pose_rmse_mean": 0.31691479682922363,
      "rmse_dtheta": 0.059933170676231384,
      "rmse_dx": 0.02240200713276863,
      "rmse_dy": 0.019634077325463295,
      "rmse_mean": 0.03398974984884262,
      "rotation_flip": 0.01750972680747509,
      "sparse_tokens": 16140.0,
      "step": 4574,
      "turn_loss": 0.3738507330417633,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 21424.0,
      "epoch": 0.2125534287307192,
      "grad_norm": 0.6665136814117432,
      "learning_rate": 6.914638666100046e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.031194329261779785,
      "mae_dx": 0.007210159208625555,
      "mae_dy": 0.004113055299967527,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6665135622024536,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.0713348388672,
      "model/head/act_norm_mean": 116.56076882102273,
      "model/head/act_norm_min": 72.79082489013672,
      "model/head/act_over_embed": 80.10165159291759,
      "model/head/grad_frac": 0.08285371959209442,
      "model/head/grad_norm": 0.05522312968969345,
      "model/head/grad_zero_frac": 0.00015673224697820842,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6828243371212122,
      "model/head/update_ratio": 0.0009471270022913814,
      "model/head/weight_delta": 7.966156005859375,
      "model/head/weight_delta_rel": 0.13974997401237488,
      "model/head/weight_norm": 58.305938720703125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4191179871559143,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4190257627572586,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41895392537117004,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28795842714778663,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09021936357021332,
      "model/modality_embedder.encoders.pose/grad_norm": 0.060132429003715515,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5321828358208955,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019461755873635411,
      "model/modality_embedder.encoders.pose/weight_delta": 2.6088552474975586,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08523943275213242,
      "model/modality_embedder.encoders.pose/weight_norm": 30.897741317749023,
      "model/modality_embedder/grad_frac": 0.09021936357021332,
      "model/modality_embedder/grad_norm": 0.060132429003715515,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5321828358208955,
      "model/modality_embedder/update_ratio": 0.0019461755873635411,
      "model/modality_embedder/weight_delta": 2.6088552474975586,
      "model/modality_embedder/weight_delta_rel": 0.08523943275213242,
      "model/modality_embedder/weight_norm": 30.897741317749023,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.55004119873047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.163434944684944,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.068448066711426,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.605338715629625,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0757327750325203,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05047691985964775,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.00181670137681067,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.9235471487045288,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07009521871805191,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.784929275512695,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.94103240966797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.020989282708033,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.629597663879395,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.194658085269296,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07817167043685913,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.052102476358413696,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017674276605248451,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.4338443279266357,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08431027084589005,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.47926902770996,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.64877319335938,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.691977438071188,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.951288223266602,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.342976789672445,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07844515144824982,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.052284758538007736,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001717998064123094,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.614656686782837,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08779527246952057,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.433536529541016,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.28536224365234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.563058035714285,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.180679321289062,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.628800893705325,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0892161875963211,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05946379899978638,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020004117395728827,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.2305328845977783,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.076229028403759,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.725778579711914,
      "model/normalizer/grad_frac": 0.3177047669887543,
      "model/normalizer/grad_norm": 0.21175454556941986,
      "model/normalizer/grad_zero_frac": 0.00013826339272782207,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0027033325750380754,
      "model/normalizer/weight_delta": 4.738079071044922,
      "model/normalizer/weight_delta_rel": 0.06102371588349342,
      "model/normalizer/weight_norm": 78.33092498779297,
      "pose_mae_dtheta": 0.27261942625045776,
      "pose_mae_dx": 0.06405556946992874,
      "pose_mae_dy": 0.059035107493400574,
      "pose_rmse_dtheta": 0.46104109287261963,
      "pose_rmse_dx": 0.15199023485183716,
      "pose_rmse_dy": 0.14761118590831757,
      "pose_rmse_mean": 0.2535475194454193,
      "rmse_dtheta": 0.04917421564459801,
      "rmse_dx": 0.016677720472216606,
      "rmse_dy": 0.008159024640917778,
      "rmse_mean": 0.024670321494340897,
      "rotation_flip": 0.006403414998203516,
      "sparse_tokens": 17122.0,
      "step": 4575,
      "turn_loss": 0.17078538239002228,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.21259988849656197,
      "grad_norm": 0.6260904669761658,
      "learning_rate": 6.913417161825449e-06,
      "loss": 0.0967,
      "mae_dtheta": 0.031720321625471115,
      "mae_dx": 0.021187491714954376,
      "mae_dy": 0.007740064058452845,
      "pose_mae_dtheta": 0.16456937789916992,
      "pose_mae_dx": 0.12631399929523468,
      "pose_mae_dy": 0.13685224950313568,
      "pose_rmse_dtheta": 0.25069037079811096,
      "pose_rmse_dx": 0.22795794904232025,
      "pose_rmse_dy": 0.2180260717868805,
      "pose_rmse_mean": 0.23222479224205017,
      "rmse_dtheta": 0.043489474803209305,
      "rmse_dx": 0.033811431378126144,
      "rmse_dy": 0.011346971616148949,
      "rmse_mean": 0.029549293220043182,
      "rotation_flip": 0.009478673338890076,
      "sparse_tokens": 3620.0,
      "step": 4576,
      "turn_loss": 0.4228106737136841,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21264634826240475,
      "grad_norm": 0.3983883559703827,
      "learning_rate": 6.9121955237445644e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.00965689867734909,
      "mae_dx": 0.0014227168867364526,
      "mae_dy": 0.0024510843213647604,
      "pose_mae_dtheta": 0.06241293624043465,
      "pose_mae_dx": 0.024176454171538353,
      "pose_mae_dy": 0.029304074123501778,
      "pose_rmse_dtheta": 0.13333311676979065,
      "pose_rmse_dx": 0.06103532016277313,
      "pose_rmse_dy": 0.06926759332418442,
      "pose_rmse_mean": 0.08787867426872253,
      "rmse_dtheta": 0.02052849344909191,
      "rmse_dx": 0.003885966958478093,
      "rmse_dy": 0.005438934080302715,
      "rmse_mean": 0.009951132349669933,
      "rotation_flip": 0.0023828435223549604,
      "sparse_tokens": 32073.0,
      "step": 4577,
      "turn_loss": 0.07379501312971115,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21269280802824753,
      "grad_norm": 0.4344012439250946,
      "learning_rate": 6.910973751942821e-06,
      "loss": 0.1253,
      "mae_dtheta": 0.011626536957919598,
      "mae_dx": 0.002672611502930522,
      "mae_dy": 0.0027002885472029448,
      "pose_mae_dtheta": 0.080508753657341,
      "pose_mae_dx": 0.02866346575319767,
      "pose_mae_dy": 0.02776794508099556,
      "pose_rmse_dtheta": 0.1883692443370819,
      "pose_rmse_dx": 0.07867538928985596,
      "pose_rmse_dy": 0.0583534874022007,
      "pose_rmse_mean": 0.10846604406833649,
      "rmse_dtheta": 0.023977428674697876,
      "rmse_dx": 0.00823947973549366,
      "rmse_dy": 0.006082444917410612,
      "rmse_mean": 0.012766450643539429,
      "rotation_flip": 0.00734341237694025,
      "sparse_tokens": 32089.0,
      "step": 4578,
      "turn_loss": 0.09899798035621643,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.21273926779409033,
      "grad_norm": 0.32540494203567505,
      "learning_rate": 6.909751846505657e-06,
      "loss": 0.0681,
      "mae_dtheta": 0.03458079695701599,
      "mae_dx": 0.015450704842805862,
      "mae_dy": 0.003443884663283825,
      "pose_mae_dtheta": 0.31326594948768616,
      "pose_mae_dx": 0.12732289731502533,
      "pose_mae_dy": 0.039001721888780594,
      "pose_rmse_dtheta": 0.5312426686286926,
      "pose_rmse_dx": 0.23836998641490936,
      "pose_rmse_dy": 0.0793774425983429,
      "pose_rmse_mean": 0.2829967141151428,
      "rmse_dtheta": 0.05023092031478882,
      "rmse_dx": 0.02664504013955593,
      "rmse_dy": 0.006281497422605753,
      "rmse_mean": 0.027719153091311455,
      "rotation_flip": 0.008064515888690948,
      "sparse_tokens": 7619.0,
      "step": 4579,
      "turn_loss": 0.19260403513908386,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2127857275599331,
      "grad_norm": 0.5779892206192017,
      "learning_rate": 6.908529807518519e-06,
      "loss": 0.1519,
      "mae_dtheta": 0.013392537832260132,
      "mae_dx": 0.00214606081135571,
      "mae_dy": 0.0032504077535122633,
      "pose_mae_dtheta": 0.08575499057769775,
      "pose_mae_dx": 0.029030093923211098,
      "pose_mae_dy": 0.0434606596827507,
      "pose_rmse_dtheta": 0.18841691315174103,
      "pose_rmse_dx": 0.08062471449375153,
      "pose_rmse_dy": 0.1042422279715538,
      "pose_rmse_mean": 0.12442795932292938,
      "rmse_dtheta": 0.026486564427614212,
      "rmse_dx": 0.007359602954238653,
      "rmse_dy": 0.006772478576749563,
      "rmse_mean": 0.01353954803198576,
      "rotation_flip": 0.009409751743078232,
      "sparse_tokens": 32041.0,
      "step": 4580,
      "turn_loss": 0.11594631522893906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21283218732577588,
      "grad_norm": 0.45788830518722534,
      "learning_rate": 6.90730763506687e-06,
      "loss": 0.1137,
      "mae_dtheta": 0.010381779633462429,
      "mae_dx": 0.002764825476333499,
      "mae_dy": 0.002897449303418398,
      "pose_mae_dtheta": 0.07546140253543854,
      "pose_mae_dx": 0.03264256939291954,
      "pose_mae_dy": 0.032706063240766525,
      "pose_rmse_dtheta": 0.1804688572883606,
      "pose_rmse_dx": 0.09236304461956024,
      "pose_rmse_dy": 0.08815114200115204,
      "pose_rmse_mean": 0.12032769620418549,
      "rmse_dtheta": 0.023205118253827095,
      "rmse_dx": 0.008389533497393131,
      "rmse_dy": 0.007275191601365805,
      "rmse_mean": 0.01295661460608244,
      "rotation_flip": 0.0053956834599375725,
      "sparse_tokens": 32089.0,
      "step": 4581,
      "turn_loss": 0.09858260303735733,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21287864709161866,
      "grad_norm": 0.533406138420105,
      "learning_rate": 6.906085329236174e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.005579174496233463,
      "mae_dx": 0.0014986034948378801,
      "mae_dy": 0.0015910938382148743,
      "pose_mae_dtheta": 0.03809674456715584,
      "pose_mae_dx": 0.017330199480056763,
      "pose_mae_dy": 0.01869266666471958,
      "pose_rmse_dtheta": 0.07546020299196243,
      "pose_rmse_dx": 0.04298584908246994,
      "pose_rmse_dy": 0.04744122922420502,
      "pose_rmse_mean": 0.05529576167464256,
      "rmse_dtheta": 0.012475687079131603,
      "rmse_dx": 0.004579529166221619,
      "rmse_dy": 0.003630818333476782,
      "rmse_mean": 0.006895345635712147,
      "rotation_flip": 0.003937007859349251,
      "sparse_tokens": 32089.0,
      "step": 4582,
      "turn_loss": 0.06341711431741714,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.21292510685746144,
      "grad_norm": 0.8011965751647949,
      "learning_rate": 6.904862890111908e-06,
      "loss": 0.1751,
      "mae_dtheta": 0.031032243743538857,
      "mae_dx": 0.012717901729047298,
      "mae_dy": 0.0024811583571135998,
      "pose_mae_dtheta": 0.23670485615730286,
      "pose_mae_dx": 0.10477349162101746,
      "pose_mae_dy": 0.028995290398597717,
      "pose_rmse_dtheta": 0.36040276288986206,
      "pose_rmse_dx": 0.2592221796512604,
      "pose_rmse_dy": 0.06691630929708481,
      "pose_rmse_mean": 0.22884708642959595,
      "rmse_dtheta": 0.04407041147351265,
      "rmse_dx": 0.02632554993033409,
      "rmse_dy": 0.004460636060684919,
      "rmse_mean": 0.024952199310064316,
      "rotation_flip": 0.0,
      "sparse_tokens": 5684.0,
      "step": 4583,
      "turn_loss": 0.1772249937057495,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.21297156662330421,
      "grad_norm": 0.4142889082431793,
      "learning_rate": 6.9036403177795565e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.03067050874233246,
      "mae_dx": 0.015609128400683403,
      "mae_dy": 0.004277159925550222,
      "pose_mae_dtheta": 0.2638876736164093,
      "pose_mae_dx": 0.13167570531368256,
      "pose_mae_dy": 0.0574420690536499,
      "pose_rmse_dtheta": 0.4792715609073639,
      "pose_rmse_dx": 0.2926177680492401,
      "pose_rmse_dy": 0.13164250552654266,
      "pose_rmse_mean": 0.3011772930622101,
      "rmse_dtheta": 0.048782654106616974,
      "rmse_dx": 0.030208511278033257,
      "rmse_dy": 0.007683608215302229,
      "rmse_mean": 0.028891591355204582,
      "rotation_flip": 0.0181818176060915,
      "sparse_tokens": 10453.0,
      "step": 4584,
      "turn_loss": 0.2595882713794708,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.213018026389147,
      "grad_norm": 0.4896661639213562,
      "learning_rate": 6.902417612324615e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.009353389963507652,
      "mae_dx": 0.0022525684908032417,
      "mae_dy": 0.0017173703527078032,
      "pose_mae_dtheta": 0.06503823399543762,
      "pose_mae_dx": 0.02213619276881218,
      "pose_mae_dy": 0.024125635623931885,
      "pose_rmse_dtheta": 0.1536763459444046,
      "pose_rmse_dx": 0.06719479709863663,
      "pose_rmse_dy": 0.0611797571182251,
      "pose_rmse_mean": 0.09401696920394897,
      "rmse_dtheta": 0.0208800807595253,
      "rmse_dx": 0.007833224721252918,
      "rmse_dy": 0.004306657239794731,
      "rmse_mean": 0.011006653308868408,
      "rotation_flip": 0.004115226212888956,
      "sparse_tokens": 32073.0,
      "step": 4585,
      "turn_loss": 0.06562291830778122,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.21306448615498977,
      "grad_norm": 0.3773120939731598,
      "learning_rate": 6.9011947738325915e-06,
      "loss": 0.0915,
      "mae_dtheta": 0.040914326906204224,
      "mae_dx": 0.010986859910190105,
      "mae_dy": 0.013360340148210526,
      "pose_mae_dtheta": 0.31307926774024963,
      "pose_mae_dx": 0.11887315660715103,
      "pose_mae_dy": 0.12923139333724976,
      "pose_rmse_dtheta": 0.5512394309043884,
      "pose_rmse_dx": 0.22328466176986694,
      "pose_rmse_dy": 0.2482822835445404,
      "pose_rmse_mean": 0.34093546867370605,
      "rmse_dtheta": 0.060545917600393295,
      "rmse_dx": 0.01993858441710472,
      "rmse_dy": 0.025871161371469498,
      "rmse_mean": 0.03545188903808594,
      "rotation_flip": 0.01690140925347805,
      "sparse_tokens": 5886.0,
      "step": 4586,
      "turn_loss": 0.41115057468414307,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 8141.0,
      "epoch": 0.21311094592083255,
      "grad_norm": 0.5930583477020264,
      "learning_rate": 6.8999718023889965e-06,
      "loss": 0.1112,
      "mae_dtheta": 0.03415026143193245,
      "mae_dx": 0.010502295568585396,
      "mae_dy": 0.004694772884249687,
      "pose_mae_dtheta": 0.25045523047447205,
      "pose_mae_dx": 0.07294660806655884,
      "pose_mae_dy": 0.0512249730527401,
      "pose_rmse_dtheta": 0.42087164521217346,
      "pose_rmse_dx": 0.15204906463623047,
      "pose_rmse_dy": 0.11360125243663788,
      "pose_rmse_mean": 0.2288406491279602,
      "rmse_dtheta": 0.050758615136146545,
      "rmse_dx": 0.02248280867934227,
      "rmse_dy": 0.008018952794373035,
      "rmse_mean": 0.02708679437637329,
      "rotation_flip": 0.02309468761086464,
      "sparse_tokens": 6481.0,
      "step": 4587,
      "turn_loss": 0.32773903012275696,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.21315740568667535,
      "grad_norm": 0.7903334498405457,
      "learning_rate": 6.898748698079352e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.042260270565748215,
      "mae_dx": 0.01573452167212963,
      "mae_dy": 0.0061859069392085075,
      "pose_mae_dtheta": 0.2931230962276459,
      "pose_mae_dx": 0.11325567960739136,
      "pose_mae_dy": 0.07946370542049408,
      "pose_rmse_dtheta": 0.5182730555534363,
      "pose_rmse_dx": 0.25428318977355957,
      "pose_rmse_dy": 0.1726056933403015,
      "pose_rmse_mean": 0.3150539994239807,
      "rmse_dtheta": 0.061689238995313644,
      "rmse_dx": 0.028810271993279457,
      "rmse_dy": 0.010876021347939968,
      "rmse_mean": 0.03379184752702713,
      "rotation_flip": 0.02590673603117466,
      "sparse_tokens": 5586.0,
      "step": 4588,
      "turn_loss": 0.28376850485801697,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 27255.0,
      "epoch": 0.21320386545251813,
      "grad_norm": 0.5250212550163269,
      "learning_rate": 6.897525460989193e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.020717930048704147,
      "mae_dx": 0.008724421262741089,
      "mae_dy": 0.004111107438802719,
      "pose_mae_dtheta": 0.18169116973876953,
      "pose_mae_dx": 0.07642297446727753,
      "pose_mae_dy": 0.0717519074678421,
      "pose_rmse_dtheta": 0.36608943343162537,
      "pose_rmse_dx": 0.20617613196372986,
      "pose_rmse_dy": 0.1848118156194687,
      "pose_rmse_mean": 0.25235915184020996,
      "rmse_dtheta": 0.03764835745096207,
      "rmse_dx": 0.02161990851163864,
      "rmse_dy": 0.00843752920627594,
      "rmse_mean": 0.02256859838962555,
      "rotation_flip": 0.015267175622284412,
      "sparse_tokens": 19350.0,
      "step": 4589,
      "turn_loss": 0.17943401634693146,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.2132503252183609,
      "grad_norm": 0.551666259765625,
      "learning_rate": 6.896302091204059e-06,
      "loss": 0.2013,
      "mae_dtheta": 0.03827643394470215,
      "mae_dx": 0.013481751084327698,
      "mae_dy": 0.005735714919865131,
      "pose_mae_dtheta": 0.2788560092449188,
      "pose_mae_dx": 0.11346492916345596,
      "pose_mae_dy": 0.06384259462356567,
      "pose_rmse_dtheta": 0.45808181166648865,
      "pose_rmse_dx": 0.2460486739873886,
      "pose_rmse_dy": 0.11837295442819595,
      "pose_rmse_mean": 0.27416783571243286,
      "rmse_dtheta": 0.053215816617012024,
      "rmse_dx": 0.02478662133216858,
      "rmse_dy": 0.009750979021191597,
      "rmse_mean": 0.029251139611005783,
      "rotation_flip": 0.0038910505827516317,
      "sparse_tokens": 8368.0,
      "step": 4590,
      "turn_loss": 0.298390656709671,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 22649.0,
      "epoch": 0.21329678498420368,
      "grad_norm": 0.42422306537628174,
      "learning_rate": 6.895078588809503e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.034589409828186035,
      "mae_dx": 0.013622093014419079,
      "mae_dy": 0.005613385234028101,
      "pose_mae_dtheta": 0.2726055681705475,
      "pose_mae_dx": 0.10690460354089737,
      "pose_mae_dy": 0.06557092070579529,
      "pose_rmse_dtheta": 0.46510520577430725,
      "pose_rmse_dx": 0.23691996932029724,
      "pose_rmse_dy": 0.13475610315799713,
      "pose_rmse_mean": 0.2789270877838135,
      "rmse_dtheta": 0.05160589888691902,
      "rmse_dx": 0.0261911042034626,
      "rmse_dy": 0.009713241830468178,
      "rmse_mean": 0.02917008101940155,
      "rotation_flip": 0.012927054427564144,
      "sparse_tokens": 17919.0,
      "step": 4591,
      "turn_loss": 0.2556067407131195,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.21334324475004646,
      "grad_norm": 0.7419646382331848,
      "learning_rate": 6.8938549538910835e-06,
      "loss": 0.1666,
      "mae_dtheta": 0.028237001970410347,
      "mae_dx": 0.01837722584605217,
      "mae_dy": 0.005518653895705938,
      "pose_mae_dtheta": 0.17290322482585907,
      "pose_mae_dx": 0.13469476997852325,
      "pose_mae_dy": 0.0847739577293396,
      "pose_rmse_dtheta": 0.3147704303264618,
      "pose_rmse_dx": 0.2765423655509949,
      "pose_rmse_dy": 0.17861945927143097,
      "pose_rmse_mean": 0.256644070148468,
      "rmse_dtheta": 0.04402078315615654,
      "rmse_dx": 0.031886499375104904,
      "rmse_dy": 0.009061689488589764,
      "rmse_mean": 0.028322990983724594,
      "rotation_flip": 0.016393441706895828,
      "sparse_tokens": 6393.0,
      "step": 4592,
      "turn_loss": 0.33684399724006653,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.21338970451588923,
      "grad_norm": 0.46679332852363586,
      "learning_rate": 6.892631186534371e-06,
      "loss": 0.1149,
      "mae_dtheta": 0.03920840471982956,
      "mae_dx": 0.01796046830713749,
      "mae_dy": 0.0077006216160953045,
      "pose_mae_dtheta": 0.2945508062839508,
      "pose_mae_dx": 0.11485784500837326,
      "pose_mae_dy": 0.09160087257623672,
      "pose_rmse_dtheta": 0.4764581024646759,
      "pose_rmse_dx": 0.2245888113975525,
      "pose_rmse_dy": 0.1784314662218094,
      "pose_rmse_mean": 0.29315948486328125,
      "rmse_dtheta": 0.053426120430231094,
      "rmse_dx": 0.031145138666033745,
      "rmse_dy": 0.012722489424049854,
      "rmse_mean": 0.03243125230073929,
      "rotation_flip": 0.026706231757998466,
      "sparse_tokens": 5686.0,
      "step": 4593,
      "turn_loss": 0.31770747900009155,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 27902.0,
      "epoch": 0.213436164281732,
      "grad_norm": 0.4944048523902893,
      "learning_rate": 6.891407286824943e-06,
      "loss": 0.0934,
      "mae_dtheta": 0.033152736723423004,
      "mae_dx": 0.012177673168480396,
      "mae_dy": 0.004142169840633869,
      "pose_mae_dtheta": 0.2500273287296295,
      "pose_mae_dx": 0.10586706548929214,
      "pose_mae_dy": 0.04585172235965729,
      "pose_rmse_dtheta": 0.4550943374633789,
      "pose_rmse_dx": 0.23100516200065613,
      "pose_rmse_dy": 0.10465575009584427,
      "pose_rmse_mean": 0.26358509063720703,
      "rmse_dtheta": 0.05158058553934097,
      "rmse_dx": 0.024855105206370354,
      "rmse_dy": 0.007571765221655369,
      "rmse_mean": 0.028002485632896423,
      "rotation_flip": 0.010997067205607891,
      "sparse_tokens": 20687.0,
      "step": 4594,
      "turn_loss": 0.25861474871635437,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2134826240475748,
      "grad_norm": 0.5603930950164795,
      "learning_rate": 6.89018325484839e-06,
      "loss": 0.1603,
      "mae_dtheta": 0.014715977944433689,
      "mae_dx": 0.0035615195520222187,
      "mae_dy": 0.0048822383396327496,
      "pose_mae_dtheta": 0.1092824786901474,
      "pose_mae_dx": 0.04283541813492775,
      "pose_mae_dy": 0.03900482505559921,
      "pose_rmse_dtheta": 0.24178466200828552,
      "pose_rmse_dx": 0.10260549187660217,
      "pose_rmse_dy": 0.07914113998413086,
      "pose_rmse_mean": 0.14117710292339325,
      "rmse_dtheta": 0.028499022126197815,
      "rmse_dx": 0.009319066070020199,
      "rmse_dy": 0.009399444796144962,
      "rmse_mean": 0.01573917828500271,
      "rotation_flip": 0.004041764885187149,
      "sparse_tokens": 32121.0,
      "step": 4595,
      "turn_loss": 0.15148992836475372,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.2135290838134176,
      "grad_norm": 0.5559968948364258,
      "learning_rate": 6.888959090690306e-06,
      "loss": 0.1497,
      "mae_dtheta": 0.050702910870313644,
      "mae_dx": 0.016155268996953964,
      "mae_dy": 0.0069686430506408215,
      "pose_mae_dtheta": 0.46302351355552673,
      "pose_mae_dx": 0.1351654976606369,
      "pose_mae_dy": 0.06506583839654922,
      "pose_rmse_dtheta": 0.689351499080658,
      "pose_rmse_dx": 0.2653743326663971,
      "pose_rmse_dy": 0.18504691123962402,
      "pose_rmse_mean": 0.3799242675304413,
      "rmse_dtheta": 0.068324014544487,
      "rmse_dx": 0.02834847755730152,
      "rmse_dy": 0.018071172758936882,
      "rmse_mean": 0.03824789077043533,
      "rotation_flip": 0.010309278033673763,
      "sparse_tokens": 11854.0,
      "step": 4596,
      "turn_loss": 0.44351914525032043,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 3603.0,
      "epoch": 0.21357554357926037,
      "grad_norm": 0.5977271795272827,
      "learning_rate": 6.887734794436301e-06,
      "loss": 0.0938,
      "mae_dtheta": 0.027684159576892853,
      "mae_dx": 0.012883272022008896,
      "mae_dy": 0.006160902790725231,
      "pose_mae_dtheta": 0.19412021338939667,
      "pose_mae_dx": 0.054726742208004,
      "pose_mae_dy": 0.1026112288236618,
      "pose_rmse_dtheta": 0.36643022298812866,
      "pose_rmse_dx": 0.12049415707588196,
      "pose_rmse_dy": 0.20596328377723694,
      "pose_rmse_mean": 0.23096255958080292,
      "rmse_dtheta": 0.04675700142979622,
      "rmse_dx": 0.026827620342373848,
      "rmse_dy": 0.010203144513070583,
      "rmse_mean": 0.027929257601499557,
      "rotation_flip": 0.012903225608170033,
      "sparse_tokens": 3250.0,
      "step": 4597,
      "turn_loss": 0.29488328099250793,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21362200334510315,
      "grad_norm": 0.45585450530052185,
      "learning_rate": 6.8865103661719856e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.011042696423828602,
      "mae_dx": 0.0014373717131093144,
      "mae_dy": 0.0023327674716711044,
      "pose_mae_dtheta": 0.07146923243999481,
      "pose_mae_dx": 0.01950228400528431,
      "pose_mae_dy": 0.028911542147397995,
      "pose_rmse_dtheta": 0.16182097792625427,
      "pose_rmse_dx": 0.0491485632956028,
      "pose_rmse_dy": 0.06458570808172226,
      "pose_rmse_mean": 0.09185175597667694,
      "rmse_dtheta": 0.02298075519502163,
      "rmse_dx": 0.004557355307042599,
      "rmse_dy": 0.0049719731323421,
      "rmse_mean": 0.01083669438958168,
      "rotation_flip": 0.005185185000300407,
      "sparse_tokens": 32105.0,
      "step": 4598,
      "turn_loss": 0.09309889376163483,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21366846311094592,
      "grad_norm": 0.5939421057701111,
      "learning_rate": 6.8852858059829885e-06,
      "loss": 0.1821,
      "mae_dtheta": 0.009092671796679497,
      "mae_dx": 0.0018254200695082545,
      "mae_dy": 0.0020978571847081184,
      "pose_mae_dtheta": 0.06919769197702408,
      "pose_mae_dx": 0.021548835560679436,
      "pose_mae_dy": 0.02505469135940075,
      "pose_rmse_dtheta": 0.1789877861738205,
      "pose_rmse_dx": 0.06649203598499298,
      "pose_rmse_dy": 0.07872121781110764,
      "pose_rmse_mean": 0.10806702077388763,
      "rmse_dtheta": 0.021180830895900726,
      "rmse_dx": 0.006208914797753096,
      "rmse_dy": 0.005655248183757067,
      "rmse_mean": 0.011014997959136963,
      "rotation_flip": 0.006640841253101826,
      "sparse_tokens": 32073.0,
      "step": 4599,
      "turn_loss": 0.07469387352466583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2137149228767887,
      "grad_norm": 0.45105960965156555,
      "learning_rate": 6.884061113954944e-06,
      "loss": 0.105,
      "mae_dtheta": 0.009249772876501083,
      "mae_dx": 0.0016880338080227375,
      "mae_dy": 0.0019032254349440336,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.45105960965156555,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.35980224609375,
      "model/head/act_norm_mean": 117.48106060606061,
      "model/head/act_norm_min": 68.64591217041016,
      "model/head/act_over_embed": 80.73408472350306,
      "model/head/grad_frac": 0.10272148996591568,
      "model/head/grad_norm": 0.04633351415395737,
      "model/head/grad_zero_frac": 0.0001805276406230405,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6933741714015151,
      "model/head/update_ratio": 0.0007945916731841862,
      "model/head/weight_delta": 7.988046169281006,
      "model/head/weight_delta_rel": 0.14013399183750153,
      "model/head/weight_norm": 58.311100006103516,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.419172078371048,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41911712379955307,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4190177917480469,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2880212113113869,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0947522297501564,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0427389033138752,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5338342658296943,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013831929536536336,
      "model/modality_embedder.encoders.pose/weight_delta": 2.6122493743896484,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08535032719373703,
      "model/modality_embedder.encoders.pose/weight_norm": 30.898727416992188,
      "model/modality_embedder/grad_frac": 0.0947522297501564,
      "model/modality_embedder/grad_norm": 0.0427389033138752,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5338342658296943,
      "model/modality_embedder/update_ratio": 0.0013831929536536336,
      "model/modality_embedder/weight_delta": 2.6122493743896484,
      "model/modality_embedder/weight_delta_rel": 0.08535032719373703,
      "model/modality_embedder/weight_norm": 30.898727416992188,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.19514465332031,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.325143799102133,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.920611381530762,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.716466554327265,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09982983022928238,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.045029204338788986,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016205654246732593,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.9304605722427368,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0703471451997757,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.78610610961914,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.5247802734375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.372795414462082,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.184769630432129,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.436422552671576,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0882321298122406,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03979795053601265,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013499150518327951,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.4431238174438477,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08463171869516373,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.48181915283203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.28477478027344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.256804152637486,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.025808334350586,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.731130995913418,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08887101709842682,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04008612781763077,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013170745223760605,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.6248981952667236,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08813916891813278,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.435733795166016,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.9428939819336,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.060981842231843,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.173748970031738,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.97097879518031,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08636126667261124,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.038954079151153564,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013103673700243235,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.2392749786376953,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07652778923511505,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.727602005004883,
      "model/normalizer/grad_frac": 0.3476686477661133,
      "model/normalizer/grad_norm": 0.15681928396224976,
      "model/normalizer/grad_zero_frac": 0.00021389465837273747,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020019428338855505,
      "model/normalizer/weight_delta": 4.756185054779053,
      "model/normalizer/weight_delta_rel": 0.061256907880306244,
      "model/normalizer/weight_norm": 78.33354949951172,
      "pose_mae_dtheta": 0.05937562510371208,
      "pose_mae_dx": 0.02140216715633869,
      "pose_mae_dy": 0.02424159273505211,
      "pose_rmse_dtheta": 0.14491303265094757,
      "pose_rmse_dx": 0.04879575967788696,
      "pose_rmse_dy": 0.0598105750977993,
      "pose_rmse_mean": 0.08450645208358765,
      "rmse_dtheta": 0.021573971956968307,
      "rmse_dx": 0.004804339725524187,
      "rmse_dy": 0.004184994846582413,
      "rmse_mean": 0.010187769308686256,
      "rotation_flip": 0.002736512804403901,
      "sparse_tokens": 32153.0,
      "step": 4600,
      "turn_loss": 0.0736076831817627,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.2137149228767887,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31500351428985596,
      "eval_objectnav_nopose_mae_dtheta": 0.04095829278230667,
      "eval_objectnav_nopose_mae_dx": 0.013612747192382812,
      "eval_objectnav_nopose_mae_dy": 0.0051156398840248585,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3365177512168884,
      "eval_objectnav_nopose_pose_mae_dx": 0.10954169929027557,
      "eval_objectnav_nopose_pose_mae_dy": 0.05801081657409668,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5601846575737,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23734883964061737,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13508576154708862,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3108730912208557,
      "eval_objectnav_nopose_rmse_dtheta": 0.058690235018730164,
      "eval_objectnav_nopose_rmse_dx": 0.02639591507613659,
      "eval_objectnav_nopose_rmse_dy": 0.01041689794510603,
      "eval_objectnav_nopose_rmse_mean": 0.031834349036216736,
      "eval_objectnav_nopose_rotation_flip": 0.014428523369133472,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31500351428985596,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 4600
    },
    {
      "epoch": 0.2137149228767887,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.291706919670105,
      "eval_objectnav_pose_mae_dtheta": 0.03776821866631508,
      "eval_objectnav_pose_mae_dx": 0.011871677823364735,
      "eval_objectnav_pose_mae_dy": 0.004769948776811361,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2952446937561035,
      "eval_objectnav_pose_pose_mae_dx": 0.09418930858373642,
      "eval_objectnav_pose_pose_mae_dy": 0.05090164393186569,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.512231171131134,
      "eval_objectnav_pose_pose_rmse_dx": 0.2157207876443863,
      "eval_objectnav_pose_pose_rmse_dy": 0.12530294060707092,
      "eval_objectnav_pose_pose_rmse_mean": 0.2844183146953583,
      "eval_objectnav_pose_rmse_dtheta": 0.05575315281748772,
      "eval_objectnav_pose_rmse_dx": 0.024327455088496208,
      "eval_objectnav_pose_rmse_dy": 0.009930349886417389,
      "eval_objectnav_pose_rmse_mean": 0.030003651976585388,
      "eval_objectnav_pose_rotation_flip": 0.015374002046883106,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.291706919670105,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 4600
    },
    {
      "epoch": 0.2137149228767887,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09718883037567139,
      "eval_pointnav_mae_dtheta": 0.01107720285654068,
      "eval_pointnav_mae_dx": 0.0026245727203786373,
      "eval_pointnav_mae_dy": 0.002640331396833062,
      "eval_pointnav_pose_mae_dtheta": 0.07798422127962112,
      "eval_pointnav_pose_mae_dx": 0.02941966988146305,
      "eval_pointnav_pose_mae_dy": 0.028853118419647217,
      "eval_pointnav_pose_rmse_dtheta": 0.21340259909629822,
      "eval_pointnav_pose_rmse_dx": 0.08537719398736954,
      "eval_pointnav_pose_rmse_dy": 0.07869012653827667,
      "eval_pointnav_pose_rmse_mean": 0.12582330405712128,
      "eval_pointnav_rmse_dtheta": 0.02642708085477352,
      "eval_pointnav_rmse_dx": 0.008019025437533855,
      "eval_pointnav_rmse_dy": 0.006799937691539526,
      "eval_pointnav_rmse_mean": 0.013748681172728539,
      "eval_pointnav_rotation_flip": 0.004958387464284897,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09718883037567139,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 4600
    },
    {
      "epoch": 0.2137149228767887,
      "eval_loss": 0.23463308811187744,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31500351428985596,
      "eval_objectnav_nopose_mae_dtheta": 0.04095829278230667,
      "eval_objectnav_nopose_mae_dx": 0.013612747192382812,
      "eval_objectnav_nopose_mae_dy": 0.0051156398840248585,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3365177512168884,
      "eval_objectnav_nopose_pose_mae_dx": 0.10954169929027557,
      "eval_objectnav_nopose_pose_mae_dy": 0.05801081657409668,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5601846575737,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23734883964061737,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13508576154708862,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3108730912208557,
      "eval_objectnav_nopose_rmse_dtheta": 0.058690235018730164,
      "eval_objectnav_nopose_rmse_dx": 0.02639591507613659,
      "eval_objectnav_nopose_rmse_dy": 0.01041689794510603,
      "eval_objectnav_nopose_rmse_mean": 0.031834349036216736,
      "eval_objectnav_nopose_rotation_flip": 0.014428523369133472,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31500351428985596,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.291706919670105,
      "eval_objectnav_pose_mae_dtheta": 0.03776821866631508,
      "eval_objectnav_pose_mae_dx": 0.011871677823364735,
      "eval_objectnav_pose_mae_dy": 0.004769948776811361,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2952446937561035,
      "eval_objectnav_pose_pose_mae_dx": 0.09418930858373642,
      "eval_objectnav_pose_pose_mae_dy": 0.05090164393186569,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.512231171131134,
      "eval_objectnav_pose_pose_rmse_dx": 0.2157207876443863,
      "eval_objectnav_pose_pose_rmse_dy": 0.12530294060707092,
      "eval_objectnav_pose_pose_rmse_mean": 0.2844183146953583,
      "eval_objectnav_pose_rmse_dtheta": 0.05575315281748772,
      "eval_objectnav_pose_rmse_dx": 0.024327455088496208,
      "eval_objectnav_pose_rmse_dy": 0.009930349886417389,
      "eval_objectnav_pose_rmse_mean": 0.030003651976585388,
      "eval_objectnav_pose_rotation_flip": 0.015374002046883106,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.291706919670105,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09718883037567139,
      "eval_pointnav_mae_dtheta": 0.01107720285654068,
      "eval_pointnav_mae_dx": 0.0026245727203786373,
      "eval_pointnav_mae_dy": 0.002640331396833062,
      "eval_pointnav_pose_mae_dtheta": 0.07798422127962112,
      "eval_pointnav_pose_mae_dx": 0.02941966988146305,
      "eval_pointnav_pose_mae_dy": 0.028853118419647217,
      "eval_pointnav_pose_rmse_dtheta": 0.21340259909629822,
      "eval_pointnav_pose_rmse_dx": 0.08537719398736954,
      "eval_pointnav_pose_rmse_dy": 0.07869012653827667,
      "eval_pointnav_pose_rmse_mean": 0.12582330405712128,
      "eval_pointnav_rmse_dtheta": 0.02642708085477352,
      "eval_pointnav_rmse_dx": 0.008019025437533855,
      "eval_pointnav_rmse_dy": 0.006799937691539526,
      "eval_pointnav_rmse_mean": 0.013748681172728539,
      "eval_pointnav_rotation_flip": 0.004958387464284897,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09718883037567139,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 4600
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.21376138264263148,
      "grad_norm": 0.6208114624023438,
      "learning_rate": 6.882836290173493e-06,
      "loss": 0.1036,
      "mae_dtheta": 0.006649933289736509,
      "mae_dx": 0.0012405614834278822,
      "mae_dy": 0.0018792698392644525,
      "pose_mae_dtheta": 0.04387564957141876,
      "pose_mae_dx": 0.016742192208766937,
      "pose_mae_dy": 0.023369960486888885,
      "pose_rmse_dtheta": 0.09060896933078766,
      "pose_rmse_dx": 0.043196745216846466,
      "pose_rmse_dy": 0.055014099925756454,
      "pose_rmse_mean": 0.06293994188308716,
      "rmse_dtheta": 0.014255128800868988,
      "rmse_dx": 0.0034721004776656628,
      "rmse_dy": 0.0046186018735170364,
      "rmse_mean": 0.007448610849678516,
      "rotation_flip": 0.005982906091958284,
      "sparse_tokens": 32121.0,
      "step": 4601,
      "turn_loss": 0.06612648814916611,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.21380784240847425,
      "grad_norm": 0.6152070760726929,
      "learning_rate": 6.881611334724292e-06,
      "loss": 0.1531,
      "mae_dtheta": 0.03207550570368767,
      "mae_dx": 0.01143858302384615,
      "mae_dy": 0.005612469278275967,
      "pose_mae_dtheta": 0.2351626306772232,
      "pose_mae_dx": 0.09088139235973358,
      "pose_mae_dy": 0.07987263053655624,
      "pose_rmse_dtheta": 0.3964864909648895,
      "pose_rmse_dx": 0.21092920005321503,
      "pose_rmse_dy": 0.17289352416992188,
      "pose_rmse_mean": 0.2601030766963959,
      "rmse_dtheta": 0.04880860075354576,
      "rmse_dx": 0.024606218561530113,
      "rmse_dy": 0.010293242521584034,
      "rmse_mean": 0.027902688831090927,
      "rotation_flip": 0.015757575631141663,
      "sparse_tokens": 14276.0,
      "step": 4602,
      "turn_loss": 0.24894197285175323,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21385430217431703,
      "grad_norm": 0.9202739596366882,
      "learning_rate": 6.880386247692999e-06,
      "loss": 0.1269,
      "mae_dtheta": 0.009673435240983963,
      "mae_dx": 0.0014008658472448587,
      "mae_dy": 0.002010365016758442,
      "pose_mae_dtheta": 0.06669506430625916,
      "pose_mae_dx": 0.02209329977631569,
      "pose_mae_dy": 0.027990801259875298,
      "pose_rmse_dtheta": 0.17617547512054443,
      "pose_rmse_dx": 0.059385500848293304,
      "pose_rmse_dy": 0.0624912865459919,
      "pose_rmse_mean": 0.09935076534748077,
      "rmse_dtheta": 0.02193352021276951,
      "rmse_dx": 0.004483198281377554,
      "rmse_dy": 0.004402862396091223,
      "rmse_mean": 0.010273193940520287,
      "rotation_flip": 0.0019327406771481037,
      "sparse_tokens": 32089.0,
      "step": 4603,
      "turn_loss": 0.07373735308647156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.21390076194015983,
      "grad_norm": 0.35470008850097656,
      "learning_rate": 6.879161029165288e-06,
      "loss": 0.0803,
      "mae_dtheta": 0.004800493363291025,
      "mae_dx": 0.0011922529665753245,
      "mae_dy": 0.0006805604789406061,
      "pose_mae_dtheta": 0.033359676599502563,
      "pose_mae_dx": 0.010845155455172062,
      "pose_mae_dy": 0.009363535791635513,
      "pose_rmse_dtheta": 0.14415983855724335,
      "pose_rmse_dx": 0.03655402734875679,
      "pose_rmse_dy": 0.029114732518792152,
      "pose_rmse_mean": 0.06994286924600601,
      "rmse_dtheta": 0.017300521954894066,
      "rmse_dx": 0.004234819207340479,
      "rmse_dy": 0.002083112485706806,
      "rmse_mean": 0.007872818037867546,
      "rotation_flip": 0.0,
      "sparse_tokens": 32121.0,
      "step": 4604,
      "turn_loss": 0.03591012582182884,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.2139472217060026,
      "grad_norm": 0.5903881192207336,
      "learning_rate": 6.877935679226836e-06,
      "loss": 0.0793,
      "mae_dtheta": 0.04628975689411163,
      "mae_dx": 0.01312241144478321,
      "mae_dy": 0.004510342609137297,
      "pose_mae_dtheta": 0.395590215921402,
      "pose_mae_dx": 0.09786690771579742,
      "pose_mae_dy": 0.061082806438207626,
      "pose_rmse_dtheta": 0.6537026166915894,
      "pose_rmse_dx": 0.21365401148796082,
      "pose_rmse_dy": 0.1453351080417633,
      "pose_rmse_mean": 0.3375639319419861,
      "rmse_dtheta": 0.06548191606998444,
      "rmse_dx": 0.025348031893372536,
      "rmse_dy": 0.00884888507425785,
      "rmse_mean": 0.03322627767920494,
      "rotation_flip": 0.017482517287135124,
      "sparse_tokens": 9286.0,
      "step": 4605,
      "turn_loss": 0.28931376338005066,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 28141.0,
      "epoch": 0.2139936814718454,
      "grad_norm": 0.509552538394928,
      "learning_rate": 6.876710197963334e-06,
      "loss": 0.1069,
      "mae_dtheta": 0.031849734485149384,
      "mae_dx": 0.010162408463656902,
      "mae_dy": 0.004962785169482231,
      "pose_mae_dtheta": 0.2448050081729889,
      "pose_mae_dx": 0.0820464938879013,
      "pose_mae_dy": 0.06915734708309174,
      "pose_rmse_dtheta": 0.4506874084472656,
      "pose_rmse_dx": 0.200945183634758,
      "pose_rmse_dy": 0.16172677278518677,
      "pose_rmse_mean": 0.2711198031902313,
      "rmse_dtheta": 0.049112360924482346,
      "rmse_dx": 0.023037027567625046,
      "rmse_dy": 0.009431217797100544,
      "rmse_mean": 0.02719353698194027,
      "rotation_flip": 0.007704160176217556,
      "sparse_tokens": 23625.0,
      "step": 4606,
      "turn_loss": 0.26071053743362427,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.21404014123768816,
      "grad_norm": 0.5075771808624268,
      "learning_rate": 6.875484585460481e-06,
      "loss": 0.1179,
      "mae_dtheta": 0.013562079519033432,
      "mae_dx": 0.003877303097397089,
      "mae_dy": 0.0031113435979932547,
      "pose_mae_dtheta": 0.10142745822668076,
      "pose_mae_dx": 0.03609615936875343,
      "pose_mae_dy": 0.029761455953121185,
      "pose_rmse_dtheta": 0.26255691051483154,
      "pose_rmse_dx": 0.0910944864153862,
      "pose_rmse_dy": 0.07329574227333069,
      "pose_rmse_mean": 0.14231571555137634,
      "rmse_dtheta": 0.030437730252742767,
      "rmse_dx": 0.01100633293390274,
      "rmse_dy": 0.007565825246274471,
      "rmse_mean": 0.016336631029844284,
      "rotation_flip": 0.002954833209514618,
      "sparse_tokens": 32169.0,
      "step": 4607,
      "turn_loss": 0.12203828990459442,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.21408660100353094,
      "grad_norm": 0.5049062967300415,
      "learning_rate": 6.874258841803985e-06,
      "loss": 0.1322,
      "mae_dtheta": 0.030209535732865334,
      "mae_dx": 0.008852998726069927,
      "mae_dy": 0.006899284664541483,
      "pose_mae_dtheta": 0.21091872453689575,
      "pose_mae_dx": 0.0758010745048523,
      "pose_mae_dy": 0.07605987042188644,
      "pose_rmse_dtheta": 0.37270358204841614,
      "pose_rmse_dx": 0.16594813764095306,
      "pose_rmse_dy": 0.17785727977752686,
      "pose_rmse_mean": 0.23883633315563202,
      "rmse_dtheta": 0.04658840224146843,
      "rmse_dx": 0.019443746656179428,
      "rmse_dy": 0.013649658299982548,
      "rmse_mean": 0.026560602709650993,
      "rotation_flip": 0.0073382253758609295,
      "sparse_tokens": 26038.0,
      "step": 4608,
      "turn_loss": 0.26946988701820374,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 27579.0,
      "epoch": 0.21413306076937372,
      "grad_norm": 1.0962092876434326,
      "learning_rate": 6.873032967079562e-06,
      "loss": 0.2585,
      "mae_dtheta": 0.032303910702466965,
      "mae_dx": 0.012999276630580425,
      "mae_dy": 0.004764847923070192,
      "pose_mae_dtheta": 0.2521153688430786,
      "pose_mae_dx": 0.11340894550085068,
      "pose_mae_dy": 0.057412564754486084,
      "pose_rmse_dtheta": 0.4724293351173401,
      "pose_rmse_dx": 0.2485668808221817,
      "pose_rmse_dy": 0.13506436347961426,
      "pose_rmse_mean": 0.28535354137420654,
      "rmse_dtheta": 0.051114462316036224,
      "rmse_dx": 0.02608746476471424,
      "rmse_dy": 0.009777274914085865,
      "rmse_mean": 0.028993068262934685,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 21856.0,
      "step": 4609,
      "turn_loss": 0.27352121472358704,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2141795205352165,
      "grad_norm": 0.6183973550796509,
      "learning_rate": 6.871806961372938e-06,
      "loss": 0.1421,
      "mae_dtheta": 0.010535732842981815,
      "mae_dx": 0.0017688816878944635,
      "mae_dy": 0.002507005352526903,
      "pose_mae_dtheta": 0.07004936784505844,
      "pose_mae_dx": 0.028040258213877678,
      "pose_mae_dy": 0.03132222592830658,
      "pose_rmse_dtheta": 0.16728343069553375,
      "pose_rmse_dx": 0.07516194134950638,
      "pose_rmse_dy": 0.0782540887594223,
      "pose_rmse_mean": 0.10689982026815414,
      "rmse_dtheta": 0.02156106010079384,
      "rmse_dx": 0.0050009130500257015,
      "rmse_dy": 0.0055026221089065075,
      "rmse_mean": 0.01068819873034954,
      "rotation_flip": 0.002291825832799077,
      "sparse_tokens": 32105.0,
      "step": 4610,
      "turn_loss": 0.08412035554647446,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.21422598030105927,
      "grad_norm": 0.49813520908355713,
      "learning_rate": 6.870580824769848e-06,
      "loss": 0.0962,
      "mae_dtheta": 0.007808585185557604,
      "mae_dx": 0.0023024880792945623,
      "mae_dy": 0.0018103253096342087,
      "pose_mae_dtheta": 0.05502542853355408,
      "pose_mae_dx": 0.029176408424973488,
      "pose_mae_dy": 0.025793015956878662,
      "pose_rmse_dtheta": 0.13856402039527893,
      "pose_rmse_dx": 0.08856209367513657,
      "pose_rmse_dy": 0.06584299355745316,
      "pose_rmse_mean": 0.09765636920928955,
      "rmse_dtheta": 0.019885290414094925,
      "rmse_dx": 0.008028220385313034,
      "rmse_dy": 0.004135293420404196,
      "rmse_mean": 0.010682934895157814,
      "rotation_flip": 0.0029850746504962444,
      "sparse_tokens": 32057.0,
      "step": 4611,
      "turn_loss": 0.08944143354892731,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.21427244006690208,
      "grad_norm": 0.6609709858894348,
      "learning_rate": 6.869354557356036e-06,
      "loss": 0.1938,
      "mae_dtheta": 0.029695922508835793,
      "mae_dx": 0.01149175874888897,
      "mae_dy": 0.0045720250345766544,
      "pose_mae_dtheta": 0.24668066203594208,
      "pose_mae_dx": 0.09129245579242706,
      "pose_mae_dy": 0.04509986191987991,
      "pose_rmse_dtheta": 0.4591771364212036,
      "pose_rmse_dx": 0.20633354783058167,
      "pose_rmse_dy": 0.10906986892223358,
      "pose_rmse_mean": 0.2581935226917267,
      "rmse_dtheta": 0.05024132877588272,
      "rmse_dx": 0.02427615225315094,
      "rmse_dy": 0.009330797009170055,
      "rmse_mean": 0.02794942632317543,
      "rotation_flip": 0.02056962065398693,
      "sparse_tokens": 10292.0,
      "step": 4612,
      "turn_loss": 0.24772529304027557,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.21431889983274485,
      "grad_norm": 0.3996117413043976,
      "learning_rate": 6.868128159217258e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.01012601051479578,
      "mae_dx": 0.0028436114080250263,
      "mae_dy": 0.004052124917507172,
      "pose_mae_dtheta": 0.06719011068344116,
      "pose_mae_dx": 0.034696660935878754,
      "pose_mae_dy": 0.034569643437862396,
      "pose_rmse_dtheta": 0.15751230716705322,
      "pose_rmse_dx": 0.08851291984319687,
      "pose_rmse_dy": 0.08985334634780884,
      "pose_rmse_mean": 0.1119595319032669,
      "rmse_dtheta": 0.021548142656683922,
      "rmse_dx": 0.007682989351451397,
      "rmse_dy": 0.009446115233004093,
      "rmse_mean": 0.01289241574704647,
      "rotation_flip": 0.004430125001817942,
      "sparse_tokens": 32121.0,
      "step": 4613,
      "turn_loss": 0.09882325679063797,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21436535959858763,
      "grad_norm": 0.3636326491832733,
      "learning_rate": 6.866901630439274e-06,
      "loss": 0.1521,
      "mae_dtheta": 0.00944342277944088,
      "mae_dx": 0.0014694614801555872,
      "mae_dy": 0.0022165761329233646,
      "pose_mae_dtheta": 0.06232971325516701,
      "pose_mae_dx": 0.02032874897122383,
      "pose_mae_dy": 0.02360687404870987,
      "pose_rmse_dtheta": 0.1727650761604309,
      "pose_rmse_dx": 0.056097839027643204,
      "pose_rmse_dy": 0.05404264107346535,
      "pose_rmse_mean": 0.09430184960365295,
      "rmse_dtheta": 0.02391812577843666,
      "rmse_dx": 0.004257910419255495,
      "rmse_dy": 0.005812013056129217,
      "rmse_mean": 0.011329349130392075,
      "rotation_flip": 0.0021477662958204746,
      "sparse_tokens": 32089.0,
      "step": 4614,
      "turn_loss": 0.06672289222478867,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.2144118193644304,
      "grad_norm": 0.7712496519088745,
      "learning_rate": 6.865674971107859e-06,
      "loss": 0.1726,
      "mae_dtheta": 0.036023207008838654,
      "mae_dx": 0.013981100171804428,
      "mae_dy": 0.004307116381824017,
      "pose_mae_dtheta": 0.2907721996307373,
      "pose_mae_dx": 0.1221858561038971,
      "pose_mae_dy": 0.065034881234169,
      "pose_rmse_dtheta": 0.5233203172683716,
      "pose_rmse_dx": 0.26376357674598694,
      "pose_rmse_dy": 0.15571846067905426,
      "pose_rmse_mean": 0.31426745653152466,
      "rmse_dtheta": 0.054291460663080215,
      "rmse_dx": 0.027009213343262672,
      "rmse_dy": 0.008990660309791565,
      "rmse_mean": 0.0300971120595932,
      "rotation_flip": 0.008108108304440975,
      "sparse_tokens": 12241.0,
      "step": 4615,
      "turn_loss": 0.23897314071655273,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.21445827913027318,
      "grad_norm": 0.5937031507492065,
      "learning_rate": 6.86444818130879e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.02165203168988228,
      "mae_dx": 0.01016860082745552,
      "mae_dy": 0.0023425412364304066,
      "pose_mae_dtheta": 0.18424008786678314,
      "pose_mae_dx": 0.06777776777744293,
      "pose_mae_dy": 0.032898690551519394,
      "pose_rmse_dtheta": 0.37860241532325745,
      "pose_rmse_dx": 0.17888304591178894,
      "pose_rmse_dy": 0.08252637833356857,
      "pose_rmse_mean": 0.21333728730678558,
      "rmse_dtheta": 0.04019938036799431,
      "rmse_dx": 0.02305806241929531,
      "rmse_dy": 0.004655887372791767,
      "rmse_mean": 0.022637777030467987,
      "rotation_flip": 0.008474576286971569,
      "sparse_tokens": 5607.0,
      "step": 4616,
      "turn_loss": 0.11497054994106293,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.21450473889611596,
      "grad_norm": 0.5252233743667603,
      "learning_rate": 6.86322126112786e-06,
      "loss": 0.1877,
      "mae_dtheta": 0.045230865478515625,
      "mae_dx": 0.014479262754321098,
      "mae_dy": 0.006247382145375013,
      "pose_mae_dtheta": 0.3300148844718933,
      "pose_mae_dx": 0.11402232199907303,
      "pose_mae_dy": 0.09054283797740936,
      "pose_rmse_dtheta": 0.4954604208469391,
      "pose_rmse_dx": 0.20416302978992462,
      "pose_rmse_dy": 0.1877341866493225,
      "pose_rmse_mean": 0.29578590393066406,
      "rmse_dtheta": 0.05824661627411842,
      "rmse_dx": 0.02573137730360031,
      "rmse_dy": 0.011099200695753098,
      "rmse_mean": 0.03169240057468414,
      "rotation_flip": 0.00899550225585699,
      "sparse_tokens": 12241.0,
      "step": 4617,
      "turn_loss": 0.37490326166152954,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.21455119866195874,
      "grad_norm": 0.43073704838752747,
      "learning_rate": 6.8619942106508665e-06,
      "loss": 0.0877,
      "mae_dtheta": 0.009210131131112576,
      "mae_dx": 0.0017263788031414151,
      "mae_dy": 0.0016791478265076876,
      "pose_mae_dtheta": 0.06760741025209427,
      "pose_mae_dx": 0.01852479577064514,
      "pose_mae_dy": 0.021268082782626152,
      "pose_rmse_dtheta": 0.2039068341255188,
      "pose_rmse_dx": 0.044956766068935394,
      "pose_rmse_dy": 0.05493582412600517,
      "pose_rmse_mean": 0.10126647353172302,
      "rmse_dtheta": 0.022934427484869957,
      "rmse_dx": 0.004928006790578365,
      "rmse_dy": 0.003989098593592644,
      "rmse_mean": 0.010617177002131939,
      "rotation_flip": 0.003405704628676176,
      "sparse_tokens": 32137.0,
      "step": 4618,
      "turn_loss": 0.07373567670583725,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2145976584278015,
      "grad_norm": 0.3663356602191925,
      "learning_rate": 6.860767029963619e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.008500373922288418,
      "mae_dx": 0.0016347788041457534,
      "mae_dy": 0.001905324519611895,
      "pose_mae_dtheta": 0.056829821318387985,
      "pose_mae_dx": 0.020621128380298615,
      "pose_mae_dy": 0.027402201667428017,
      "pose_rmse_dtheta": 0.10762932151556015,
      "pose_rmse_dx": 0.05960054323077202,
      "pose_rmse_dy": 0.06089155375957489,
      "pose_rmse_mean": 0.07604047656059265,
      "rmse_dtheta": 0.017025329172611237,
      "rmse_dx": 0.006135729141533375,
      "rmse_dy": 0.0038995842915028334,
      "rmse_mean": 0.009020213969051838,
      "rotation_flip": 0.0037950663827359676,
      "sparse_tokens": 32089.0,
      "step": 4619,
      "turn_loss": 0.08311827480792999,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36338.0,
      "epoch": 0.21464411819364432,
      "grad_norm": 0.4511246383190155,
      "learning_rate": 6.859539719151933e-06,
      "loss": 0.1713,
      "mae_dtheta": 0.039297688752412796,
      "mae_dx": 0.011853004805743694,
      "mae_dy": 0.00564742973074317,
      "pose_mae_dtheta": 0.32763126492500305,
      "pose_mae_dx": 0.0982181653380394,
      "pose_mae_dy": 0.07793810963630676,
      "pose_rmse_dtheta": 0.5359811782836914,
      "pose_rmse_dx": 0.20029622316360474,
      "pose_rmse_dy": 0.1669255644083023,
      "pose_rmse_mean": 0.30106765031814575,
      "rmse_dtheta": 0.055496763437986374,
      "rmse_dx": 0.02316819317638874,
      "rmse_dy": 0.010581020265817642,
      "rmse_mean": 0.02974865958094597,
      "rotation_flip": 0.014326647855341434,
      "sparse_tokens": 26532.0,
      "step": 4620,
      "turn_loss": 0.3198842406272888,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 29108.0,
      "epoch": 0.2146905779594871,
      "grad_norm": 0.9918302893638611,
      "learning_rate": 6.858312278301638e-06,
      "loss": 0.3186,
      "mae_dtheta": 0.03751736506819725,
      "mae_dx": 0.013683916069567204,
      "mae_dy": 0.005347317550331354,
      "pose_mae_dtheta": 0.32293668389320374,
      "pose_mae_dx": 0.1172722801566124,
      "pose_mae_dy": 0.058398470282554626,
      "pose_rmse_dtheta": 0.5399796366691589,
      "pose_rmse_dx": 0.23645833134651184,
      "pose_rmse_dy": 0.162873312830925,
      "pose_rmse_mean": 0.3131037950515747,
      "rmse_dtheta": 0.055052876472473145,
      "rmse_dx": 0.025025412440299988,
      "rmse_dy": 0.013938428834080696,
      "rmse_mean": 0.03133890777826309,
      "rotation_flip": 0.013523666188120842,
      "sparse_tokens": 21721.0,
      "step": 4621,
      "turn_loss": 0.2848610281944275,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21473703772532987,
      "grad_norm": 0.41478443145751953,
      "learning_rate": 6.857084707498567e-06,
      "loss": 0.0817,
      "mae_dtheta": 0.009296162985265255,
      "mae_dx": 0.0012608550023287535,
      "mae_dy": 0.0019471081905066967,
      "pose_mae_dtheta": 0.06563109904527664,
      "pose_mae_dx": 0.01796891540288925,
      "pose_mae_dy": 0.025089075788855553,
      "pose_rmse_dtheta": 0.1642768383026123,
      "pose_rmse_dx": 0.04580526426434517,
      "pose_rmse_dy": 0.05248795822262764,
      "pose_rmse_mean": 0.08752335608005524,
      "rmse_dtheta": 0.02066047303378582,
      "rmse_dx": 0.0037577177863568068,
      "rmse_dy": 0.004062322434037924,
      "rmse_mean": 0.009493504650890827,
      "rotation_flip": 0.0034980324562639,
      "sparse_tokens": 32073.0,
      "step": 4622,
      "turn_loss": 0.07270050048828125,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.21478349749117265,
      "grad_norm": 0.6197226643562317,
      "learning_rate": 6.855857006828567e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.007442418951541185,
      "mae_dx": 0.0014195448020473123,
      "mae_dy": 0.0006968648522160947,
      "pose_mae_dtheta": 0.05618387088179588,
      "pose_mae_dx": 0.012098780833184719,
      "pose_mae_dy": 0.011334161274135113,
      "pose_rmse_dtheta": 0.2213602513074875,
      "pose_rmse_dx": 0.026801778003573418,
      "pose_rmse_dy": 0.03321366012096405,
      "pose_rmse_mean": 0.0937919020652771,
      "rmse_dtheta": 0.025960899889469147,
      "rmse_dx": 0.004032054450362921,
      "rmse_dy": 0.001581982127390802,
      "rmse_mean": 0.010524979792535305,
      "rotation_flip": 0.005769230891019106,
      "sparse_tokens": 32217.0,
      "step": 4623,
      "turn_loss": 0.04577475041151047,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21482995725701542,
      "grad_norm": 0.48519501090049744,
      "learning_rate": 6.85462917637749e-06,
      "loss": 0.1932,
      "mae_dtheta": 0.009306046180427074,
      "mae_dx": 0.0019708522595465183,
      "mae_dy": 0.0022856690920889378,
      "pose_mae_dtheta": 0.0656685158610344,
      "pose_mae_dx": 0.025457467883825302,
      "pose_mae_dy": 0.022785799577832222,
      "pose_rmse_dtheta": 0.19678348302841187,
      "pose_rmse_dx": 0.07984525710344315,
      "pose_rmse_dy": 0.055097270756959915,
      "pose_rmse_mean": 0.11057534068822861,
      "rmse_dtheta": 0.024578850716352463,
      "rmse_dx": 0.005650602746754885,
      "rmse_dy": 0.00608097156509757,
      "rmse_mean": 0.012103474698960781,
      "rotation_flip": 0.0036003601271659136,
      "sparse_tokens": 32089.0,
      "step": 4624,
      "turn_loss": 0.07072772830724716,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2148764170228582,
      "grad_norm": 0.4425069987773895,
      "learning_rate": 6.853401216231198e-06,
      "loss": 0.0896,
      "mae_dtheta": 0.011840901337563992,
      "mae_dx": 0.0011641369201242924,
      "mae_dy": 0.0024104772601276636,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44250690937042236,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.10122680664062,
      "model/head/act_norm_mean": 115.37506904987374,
      "model/head/act_norm_min": 81.791015625,
      "model/head/act_over_embed": 79.28682760948786,
      "model/head/grad_frac": 0.09164123982191086,
      "model/head/grad_norm": 0.04055188223719597,
      "model/head/grad_zero_frac": 0.0001713267556624487,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.696584990530303,
      "model/head/update_ratio": 0.000695384107530117,
      "model/head/weight_delta": 8.005905151367188,
      "model/head/weight_delta_rel": 0.14044728875160217,
      "model/head/weight_norm": 58.31580352783203,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41924533247947693,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41916808391588306,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4190894365310669,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28805623158042504,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08729790151119232,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0386299230158329,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5456642392533937,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001250172732397914,
      "model/modality_embedder.encoders.pose/weight_delta": 2.621030330657959,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08563722670078278,
      "model/modality_embedder.encoders.pose/weight_norm": 30.899669647216797,
      "model/modality_embedder/grad_frac": 0.08729790151119232,
      "model/modality_embedder/grad_norm": 0.0386299230158329,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5456642392533937,
      "model/modality_embedder/update_ratio": 0.001250172732397914,
      "model/modality_embedder/weight_delta": 2.621030330657959,
      "model/modality_embedder/weight_delta_rel": 0.08563722670078278,
      "model/modality_embedder/weight_norm": 30.899669647216797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.99515533447266,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.096372955747956,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.108209609985352,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.559253088987894,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06386255472898483,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02825962007045746,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010170055320486426,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.9372425079345703,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07059428840875626,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.787086486816406,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.84581756591797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.140802869969537,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.508277893066406,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.27699510414788,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06780200451612473,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030002856627106667,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010175688657909632,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.4520106315612793,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08493956178426743,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.484840393066406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.75773620605469,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.044677930094597,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.748014450073242,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.585355869824962,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07083021104335785,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03134285658597946,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010297098197042942,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.6346821784973145,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08846769481897354,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.438533782958984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.59163665771484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.856473965848966,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.955007553100586,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.830439067897096,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09331833571195602,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04129400849342346,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013889862457290292,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.2474520206451416,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07680724561214447,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.729602813720703,
      "model/normalizer/grad_frac": 0.32012903690338135,
      "model/normalizer/grad_norm": 0.14165930449962616,
      "model/normalizer/grad_zero_frac": 0.00016780685109551996,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018083412433043122,
      "model/normalizer/weight_delta": 4.773523807525635,
      "model/normalizer/weight_delta_rel": 0.06148022413253784,
      "model/normalizer/weight_norm": 78.33660125732422,
      "pose_mae_dtheta": 0.08075372129678726,
      "pose_mae_dx": 0.021243548020720482,
      "pose_mae_dy": 0.032410189509391785,
      "pose_rmse_dtheta": 0.21906457841396332,
      "pose_rmse_dx": 0.05581223592162132,
      "pose_rmse_dy": 0.0781351625919342,
      "pose_rmse_mean": 0.11767065525054932,
      "rmse_dtheta": 0.025944679975509644,
      "rmse_dx": 0.002967600477859378,
      "rmse_dy": 0.005261128302663565,
      "rmse_mean": 0.01139113586395979,
      "rotation_flip": 0.005324813537299633,
      "sparse_tokens": 32089.0,
      "step": 4625,
      "turn_loss": 0.09271523356437683,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30170.0,
      "epoch": 0.21492287678870098,
      "grad_norm": 0.5480402708053589,
      "learning_rate": 6.852173126475565e-06,
      "loss": 0.1406,
      "mae_dtheta": 0.02683154307305813,
      "mae_dx": 0.010516970418393612,
      "mae_dy": 0.002108546905219555,
      "pose_mae_dtheta": 0.21150527894496918,
      "pose_mae_dx": 0.07931656390428543,
      "pose_mae_dy": 0.0198662169277668,
      "pose_rmse_dtheta": 0.42050182819366455,
      "pose_rmse_dx": 0.19175562262535095,
      "pose_rmse_dy": 0.0548580028116703,
      "pose_rmse_mean": 0.22237184643745422,
      "rmse_dtheta": 0.046657368540763855,
      "rmse_dx": 0.02266760729253292,
      "rmse_dy": 0.0047654053196311,
      "rmse_mean": 0.024696795269846916,
      "rotation_flip": 0.0034934498835355043,
      "sparse_tokens": 25469.0,
      "step": 4626,
      "turn_loss": 0.19732266664505005,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 15866.0,
      "epoch": 0.21496933655454376,
      "grad_norm": 0.43682506680488586,
      "learning_rate": 6.850944907196472e-06,
      "loss": 0.1109,
      "mae_dtheta": 0.0331728421151638,
      "mae_dx": 0.014956093393266201,
      "mae_dy": 0.006593140307813883,
      "pose_mae_dtheta": 0.2544151842594147,
      "pose_mae_dx": 0.1361638605594635,
      "pose_mae_dy": 0.09117606282234192,
      "pose_rmse_dtheta": 0.38206836581230164,
      "pose_rmse_dx": 0.26310133934020996,
      "pose_rmse_dy": 0.18183137476444244,
      "pose_rmse_mean": 0.2756670415401459,
      "rmse_dtheta": 0.04722259193658829,
      "rmse_dx": 0.027372965589165688,
      "rmse_dy": 0.011792455799877644,
      "rmse_mean": 0.028796005994081497,
      "rotation_flip": 0.016129031777381897,
      "sparse_tokens": 12496.0,
      "step": 4627,
      "turn_loss": 0.29781612753868103,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.21501579632038653,
      "grad_norm": 0.6026836633682251,
      "learning_rate": 6.849716558479806e-06,
      "loss": 0.1585,
      "mae_dtheta": 0.03262587636709213,
      "mae_dx": 0.009692695923149586,
      "mae_dy": 0.0044645327143371105,
      "pose_mae_dtheta": 0.26069965958595276,
      "pose_mae_dx": 0.06934960931539536,
      "pose_mae_dy": 0.05093934386968613,
      "pose_rmse_dtheta": 0.4748609960079193,
      "pose_rmse_dx": 0.17112873494625092,
      "pose_rmse_dy": 0.12996847927570343,
      "pose_rmse_mean": 0.2586527466773987,
      "rmse_dtheta": 0.05272133648395538,
      "rmse_dx": 0.021316012367606163,
      "rmse_dy": 0.008631161414086819,
      "rmse_mean": 0.027556171640753746,
      "rotation_flip": 0.009296149015426636,
      "sparse_tokens": 13550.0,
      "step": 4628,
      "turn_loss": 0.23390553891658783,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.21506225608622934,
      "grad_norm": 0.47329920530319214,
      "learning_rate": 6.8484880804114705e-06,
      "loss": 0.1467,
      "mae_dtheta": 0.037327270954847336,
      "mae_dx": 0.013217350468039513,
      "mae_dy": 0.005604931619018316,
      "pose_mae_dtheta": 0.2938441336154938,
      "pose_mae_dx": 0.09375820308923721,
      "pose_mae_dy": 0.05469305440783501,
      "pose_rmse_dtheta": 0.5484940409660339,
      "pose_rmse_dx": 0.21576538681983948,
      "pose_rmse_dy": 0.1288059502840042,
      "pose_rmse_mean": 0.29768848419189453,
      "rmse_dtheta": 0.057787638157606125,
      "rmse_dx": 0.02609197609126568,
      "rmse_dy": 0.01254250854253769,
      "rmse_mean": 0.03214070945978165,
      "rotation_flip": 0.01660735532641411,
      "sparse_tokens": 13660.0,
      "step": 4629,
      "turn_loss": 0.2967096269130707,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.2151087158520721,
      "grad_norm": 0.5733766555786133,
      "learning_rate": 6.84725947307737e-06,
      "loss": 0.1243,
      "mae_dtheta": 0.052812449634075165,
      "mae_dx": 0.016365235671401024,
      "mae_dy": 0.00577322905883193,
      "pose_mae_dtheta": 0.448257178068161,
      "pose_mae_dx": 0.1233891025185585,
      "pose_mae_dy": 0.06384555250406265,
      "pose_rmse_dtheta": 0.6634141802787781,
      "pose_rmse_dx": 0.2462431937456131,
      "pose_rmse_dy": 0.16397689282894135,
      "pose_rmse_mean": 0.35787808895111084,
      "rmse_dtheta": 0.06865044683218002,
      "rmse_dx": 0.02895282208919525,
      "rmse_dy": 0.013284346088767052,
      "rmse_mean": 0.036962538957595825,
      "rotation_flip": 0.010922330431640148,
      "sparse_tokens": 12515.0,
      "step": 4630,
      "turn_loss": 0.36478370428085327,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2151551756179149,
      "grad_norm": 0.49021846055984497,
      "learning_rate": 6.8460307365634225e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.00802790280431509,
      "mae_dx": 0.0018327893922105432,
      "mae_dy": 0.0015917230630293489,
      "pose_mae_dtheta": 0.058030225336551666,
      "pose_mae_dx": 0.020484237000346184,
      "pose_mae_dy": 0.01908581145107746,
      "pose_rmse_dtheta": 0.19370217621326447,
      "pose_rmse_dx": 0.06157686561346054,
      "pose_rmse_dy": 0.052037015557289124,
      "pose_rmse_mean": 0.10243868827819824,
      "rmse_dtheta": 0.02269645221531391,
      "rmse_dx": 0.005829757545143366,
      "rmse_dy": 0.004200919531285763,
      "rmse_mean": 0.010909043252468109,
      "rotation_flip": 0.002896871417760849,
      "sparse_tokens": 32073.0,
      "step": 4631,
      "turn_loss": 0.05895746126770973,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.21520163538375767,
      "grad_norm": 0.6316343545913696,
      "learning_rate": 6.844801870955556e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.010136624798178673,
      "mae_dx": 0.0017456247005611658,
      "mae_dy": 0.002710650907829404,
      "pose_mae_dtheta": 0.07106712460517883,
      "pose_mae_dx": 0.025513190776109695,
      "pose_mae_dy": 0.027273157611489296,
      "pose_rmse_dtheta": 0.1882806420326233,
      "pose_rmse_dx": 0.0661202073097229,
      "pose_rmse_dy": 0.06794749200344086,
      "pose_rmse_mean": 0.10744945704936981,
      "rmse_dtheta": 0.024041257798671722,
      "rmse_dx": 0.005199459847062826,
      "rmse_dy": 0.006599066313356161,
      "rmse_mean": 0.011946595273911953,
      "rotation_flip": 0.004126031417399645,
      "sparse_tokens": 32121.0,
      "step": 4632,
      "turn_loss": 0.08724189549684525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.21524809514960044,
      "grad_norm": 0.659366250038147,
      "learning_rate": 6.8435728763397045e-06,
      "loss": 0.2664,
      "mae_dtheta": 0.032259706407785416,
      "mae_dx": 0.007985792122781277,
      "mae_dy": 0.0027001486159861088,
      "pose_mae_dtheta": 0.2582467794418335,
      "pose_mae_dx": 0.059999000281095505,
      "pose_mae_dy": 0.032472312450408936,
      "pose_rmse_dtheta": 0.4802621901035309,
      "pose_rmse_dx": 0.15179739892482758,
      "pose_rmse_dy": 0.0732848048210144,
      "pose_rmse_mean": 0.23511479794979095,
      "rmse_dtheta": 0.05156752094626427,
      "rmse_dx": 0.019421353936195374,
      "rmse_dy": 0.005279499106109142,
      "rmse_mean": 0.02542279288172722,
      "rotation_flip": 0.02083333395421505,
      "sparse_tokens": 9654.0,
      "step": 4633,
      "turn_loss": 0.27042120695114136,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.21529455491544322,
      "grad_norm": 0.5784945487976074,
      "learning_rate": 6.842343752801812e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.012954790145158768,
      "mae_dx": 0.0028453138656914234,
      "mae_dy": 0.003223082749173045,
      "pose_mae_dtheta": 0.0940852090716362,
      "pose_mae_dx": 0.02694578655064106,
      "pose_mae_dy": 0.030894918367266655,
      "pose_rmse_dtheta": 0.22820298373699188,
      "pose_rmse_dx": 0.0672040581703186,
      "pose_rmse_dy": 0.07090777158737183,
      "pose_rmse_mean": 0.1221049427986145,
      "rmse_dtheta": 0.027330055832862854,
      "rmse_dx": 0.008225715719163418,
      "rmse_dy": 0.007724934257566929,
      "rmse_mean": 0.014426901936531067,
      "rotation_flip": 0.005501618143171072,
      "sparse_tokens": 32169.0,
      "step": 4634,
      "turn_loss": 0.12214406579732895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.215341014681286,
      "grad_norm": 0.7851121425628662,
      "learning_rate": 6.841114500427832e-06,
      "loss": 0.2097,
      "mae_dtheta": 0.01187305711209774,
      "mae_dx": 0.0018310820451006293,
      "mae_dy": 0.0030174213461577892,
      "pose_mae_dtheta": 0.08486589044332504,
      "pose_mae_dx": 0.030964788049459457,
      "pose_mae_dy": 0.035280000418424606,
      "pose_rmse_dtheta": 0.22896766662597656,
      "pose_rmse_dx": 0.08879578858613968,
      "pose_rmse_dy": 0.0972495749592781,
      "pose_rmse_mean": 0.13833767175674438,
      "rmse_dtheta": 0.027279162779450417,
      "rmse_dx": 0.004740739706903696,
      "rmse_dy": 0.007201233878731728,
      "rmse_mean": 0.013073712587356567,
      "rotation_flip": 0.011966493912041187,
      "sparse_tokens": 32105.0,
      "step": 4635,
      "turn_loss": 0.10109329223632812,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.21538747444712877,
      "grad_norm": 0.3930485248565674,
      "learning_rate": 6.839885119303726e-06,
      "loss": 0.0854,
      "mae_dtheta": 0.02538279816508293,
      "mae_dx": 0.010127143003046513,
      "mae_dy": 0.004305226728320122,
      "pose_mae_dtheta": 0.16435186564922333,
      "pose_mae_dx": 0.07453131675720215,
      "pose_mae_dy": 0.05488727241754532,
      "pose_rmse_dtheta": 0.2995305061340332,
      "pose_rmse_dx": 0.1750086098909378,
      "pose_rmse_dy": 0.12934550642967224,
      "pose_rmse_mean": 0.20129486918449402,
      "rmse_dtheta": 0.040319472551345825,
      "rmse_dx": 0.02233870141208172,
      "rmse_dy": 0.008053476922214031,
      "rmse_mean": 0.023570550605654716,
      "rotation_flip": 0.010494752787053585,
      "sparse_tokens": 11857.0,
      "step": 4636,
      "turn_loss": 0.2058204561471939,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 22071.0,
      "epoch": 0.21543393421297158,
      "grad_norm": 0.37193071842193604,
      "learning_rate": 6.838655609515467e-06,
      "loss": 0.0794,
      "mae_dtheta": 0.023342041298747063,
      "mae_dx": 0.00688391225412488,
      "mae_dy": 0.003988588694483042,
      "pose_mae_dtheta": 0.1824207603931427,
      "pose_mae_dx": 0.053752750158309937,
      "pose_mae_dy": 0.05871045961976051,
      "pose_rmse_dtheta": 0.3975673317909241,
      "pose_rmse_dx": 0.14641965925693512,
      "pose_rmse_dy": 0.14118222892284393,
      "pose_rmse_mean": 0.22838973999023438,
      "rmse_dtheta": 0.04299227520823479,
      "rmse_dx": 0.01812027208507061,
      "rmse_dy": 0.0076010157354176044,
      "rmse_mean": 0.022904520854353905,
      "rotation_flip": 0.004878048785030842,
      "sparse_tokens": 17613.0,
      "step": 4637,
      "turn_loss": 0.17747876048088074,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21548039397881436,
      "grad_norm": 0.512035608291626,
      "learning_rate": 6.837425971149034e-06,
      "loss": 0.08,
      "mae_dtheta": 0.007254225667566061,
      "mae_dx": 0.001416670624166727,
      "mae_dy": 0.0016140948282554746,
      "pose_mae_dtheta": 0.04859564080834389,
      "pose_mae_dx": 0.019033897668123245,
      "pose_mae_dy": 0.02185417152941227,
      "pose_rmse_dtheta": 0.112705759704113,
      "pose_rmse_dx": 0.0517667755484581,
      "pose_rmse_dy": 0.04746823385357857,
      "pose_rmse_mean": 0.07064692676067352,
      "rmse_dtheta": 0.01789950765669346,
      "rmse_dx": 0.005042072851210833,
      "rmse_dy": 0.003541604382917285,
      "rmse_mean": 0.00882772821933031,
      "rotation_flip": 0.0030987162608653307,
      "sparse_tokens": 32073.0,
      "step": 4638,
      "turn_loss": 0.05933195352554321,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.21552685374465713,
      "grad_norm": 0.500579833984375,
      "learning_rate": 6.836196204290417e-06,
      "loss": 0.1342,
      "mae_dtheta": 0.010317966341972351,
      "mae_dx": 0.0023526581935584545,
      "mae_dy": 0.0015995021676644683,
      "pose_mae_dtheta": 0.06876298040151596,
      "pose_mae_dx": 0.02242855913937092,
      "pose_mae_dy": 0.01819920912384987,
      "pose_rmse_dtheta": 0.17279115319252014,
      "pose_rmse_dx": 0.05180809274315834,
      "pose_rmse_dy": 0.043695613741874695,
      "pose_rmse_mean": 0.08943162858486176,
      "rmse_dtheta": 0.023582149296998978,
      "rmse_dx": 0.006632570642977953,
      "rmse_dy": 0.003697418374940753,
      "rmse_mean": 0.011304046027362347,
      "rotation_flip": 0.0050159599632024765,
      "sparse_tokens": 32201.0,
      "step": 4639,
      "turn_loss": 0.09237848967313766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2155733135104999,
      "grad_norm": 0.6884530186653137,
      "learning_rate": 6.834966309025614e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.013652078807353973,
      "mae_dx": 0.0031846167985349894,
      "mae_dy": 0.004468668717890978,
      "pose_mae_dtheta": 0.09415905177593231,
      "pose_mae_dx": 0.037929434329271317,
      "pose_mae_dy": 0.040806856006383896,
      "pose_rmse_dtheta": 0.18850913643836975,
      "pose_rmse_dx": 0.09007569402456284,
      "pose_rmse_dy": 0.09481298923492432,
      "pose_rmse_mean": 0.1244659423828125,
      "rmse_dtheta": 0.02594541572034359,
      "rmse_dx": 0.007967226207256317,
      "rmse_dy": 0.009317873045802116,
      "rmse_mean": 0.014410173520445824,
      "rotation_flip": 0.009756097570061684,
      "sparse_tokens": 32153.0,
      "step": 4640,
      "turn_loss": 0.13189303874969482,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.21561977327634269,
      "grad_norm": 0.5777184367179871,
      "learning_rate": 6.833736285440632e-06,
      "loss": 0.1337,
      "mae_dtheta": 0.03713101148605347,
      "mae_dx": 0.010773680172860622,
      "mae_dy": 0.006852398626506329,
      "pose_mae_dtheta": 0.3047516942024231,
      "pose_mae_dx": 0.08527499437332153,
      "pose_mae_dy": 0.07716004550457001,
      "pose_rmse_dtheta": 0.5586357712745667,
      "pose_rmse_dx": 0.1965535283088684,
      "pose_rmse_dy": 0.17560845613479614,
      "pose_rmse_mean": 0.3102659285068512,
      "rmse_dtheta": 0.05539180710911751,
      "rmse_dx": 0.022982070222496986,
      "rmse_dy": 0.011753571219742298,
      "rmse_mean": 0.030042484402656555,
      "rotation_flip": 0.027397260069847107,
      "sparse_tokens": 5567.0,
      "step": 4641,
      "turn_loss": 0.24650898575782776,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.21566623304218546,
      "grad_norm": 0.4682551920413971,
      "learning_rate": 6.832506133621487e-06,
      "loss": 0.0876,
      "mae_dtheta": 0.006896588485687971,
      "mae_dx": 0.0013110152212902904,
      "mae_dy": 0.0015077595598995686,
      "pose_mae_dtheta": 0.04898503050208092,
      "pose_mae_dx": 0.016573525965213776,
      "pose_mae_dy": 0.02239346317946911,
      "pose_rmse_dtheta": 0.11205998808145523,
      "pose_rmse_dx": 0.04334259033203125,
      "pose_rmse_dy": 0.059268519282341,
      "pose_rmse_mean": 0.07155703008174896,
      "rmse_dtheta": 0.016445796936750412,
      "rmse_dx": 0.0046044448390603065,
      "rmse_dy": 0.0034768013283610344,
      "rmse_mean": 0.008175681345164776,
      "rotation_flip": 0.00518433190882206,
      "sparse_tokens": 32041.0,
      "step": 4642,
      "turn_loss": 0.06451044231653214,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21571269280802824,
      "grad_norm": 0.5693970918655396,
      "learning_rate": 6.831275853654205e-06,
      "loss": 0.1076,
      "mae_dtheta": 0.01013423316180706,
      "mae_dx": 0.0014632404781877995,
      "mae_dy": 0.001758992439135909,
      "pose_mae_dtheta": 0.06614823639392853,
      "pose_mae_dx": 0.017698796465992928,
      "pose_mae_dy": 0.022371109575033188,
      "pose_rmse_dtheta": 0.17920006811618805,
      "pose_rmse_dx": 0.04465138167142868,
      "pose_rmse_dy": 0.05544968694448471,
      "pose_rmse_mean": 0.09310038387775421,
      "rmse_dtheta": 0.023422174155712128,
      "rmse_dx": 0.004450198262929916,
      "rmse_dy": 0.0036888285540044308,
      "rmse_mean": 0.01052040047943592,
      "rotation_flip": 0.004676539450883865,
      "sparse_tokens": 32105.0,
      "step": 4643,
      "turn_loss": 0.08565261214971542,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.21575915257387102,
      "grad_norm": 0.5252924561500549,
      "learning_rate": 6.830045445624819e-06,
      "loss": 0.1415,
      "mae_dtheta": 0.04270443692803383,
      "mae_dx": 0.016786491498351097,
      "mae_dy": 0.015217836014926434,
      "pose_mae_dtheta": 0.3683549463748932,
      "pose_mae_dx": 0.15742270648479462,
      "pose_mae_dy": 0.12124979496002197,
      "pose_rmse_dtheta": 0.60230952501297,
      "pose_rmse_dx": 0.3743498623371124,
      "pose_rmse_dy": 0.24413318932056427,
      "pose_rmse_mean": 0.4069308936595917,
      "rmse_dtheta": 0.06157505139708519,
      "rmse_dx": 0.03193357586860657,
      "rmse_dy": 0.029613645747303963,
      "rmse_mean": 0.04104075953364372,
      "rotation_flip": 0.011990407481789589,
      "sparse_tokens": 7333.0,
      "step": 4644,
      "turn_loss": 0.6005038619041443,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.21580561233971382,
      "grad_norm": 0.30198800563812256,
      "learning_rate": 6.828814909619374e-06,
      "loss": 0.0657,
      "mae_dtheta": 0.006628493778407574,
      "mae_dx": 0.0010167380096390843,
      "mae_dy": 0.0014220611192286015,
      "pose_mae_dtheta": 0.04470038041472435,
      "pose_mae_dx": 0.014315961860120296,
      "pose_mae_dy": 0.02201085537672043,
      "pose_rmse_dtheta": 0.11363603919744492,
      "pose_rmse_dx": 0.04018576443195343,
      "pose_rmse_dy": 0.05457264557480812,
      "pose_rmse_mean": 0.06946481764316559,
      "rmse_dtheta": 0.016740471124649048,
      "rmse_dx": 0.00325659173540771,
      "rmse_dy": 0.0030678093899041414,
      "rmse_mean": 0.0076882909052073956,
      "rotation_flip": 0.0030060119461268187,
      "sparse_tokens": 32057.0,
      "step": 4645,
      "turn_loss": 0.055849142372608185,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.2158520721055566,
      "grad_norm": 0.4670991897583008,
      "learning_rate": 6.827584245723919e-06,
      "loss": 0.1313,
      "mae_dtheta": 0.04001918435096741,
      "mae_dx": 0.007308147847652435,
      "mae_dy": 0.005259603727608919,
      "pose_mae_dtheta": 0.33570927381515503,
      "pose_mae_dx": 0.06192854046821594,
      "pose_mae_dy": 0.08586878329515457,
      "pose_rmse_dtheta": 0.6208785772323608,
      "pose_rmse_dx": 0.14830929040908813,
      "pose_rmse_dy": 0.2008090615272522,
      "pose_rmse_mean": 0.3233323097229004,
      "rmse_dtheta": 0.0626165047287941,
      "rmse_dx": 0.018001599237322807,
      "rmse_dy": 0.01032573077827692,
      "rmse_mean": 0.0303146131336689,
      "rotation_flip": 0.010973936878144741,
      "sparse_tokens": 12031.0,
      "step": 4646,
      "turn_loss": 0.24428896605968475,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.21589853187139937,
      "grad_norm": 0.4882230758666992,
      "learning_rate": 6.826353454024518e-06,
      "loss": 0.08,
      "mae_dtheta": 0.009426389820873737,
      "mae_dx": 0.0018012713408097625,
      "mae_dy": 0.0018858477706089616,
      "pose_mae_dtheta": 0.06176310032606125,
      "pose_mae_dx": 0.021330349147319794,
      "pose_mae_dy": 0.026776423677802086,
      "pose_rmse_dtheta": 0.14543181657791138,
      "pose_rmse_dx": 0.05512911453843117,
      "pose_rmse_dy": 0.06167580187320709,
      "pose_rmse_mean": 0.08741223812103271,
      "rmse_dtheta": 0.018567781895399094,
      "rmse_dx": 0.005734060890972614,
      "rmse_dy": 0.0035137294325977564,
      "rmse_mean": 0.00927185732871294,
      "rotation_flip": 0.0018389113247394562,
      "sparse_tokens": 32121.0,
      "step": 4647,
      "turn_loss": 0.07160729914903641,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.21594499163724215,
      "grad_norm": 0.5173946022987366,
      "learning_rate": 6.8251225346072395e-06,
      "loss": 0.1586,
      "mae_dtheta": 0.035793378949165344,
      "mae_dx": 0.011463462375104427,
      "mae_dy": 0.004372130613774061,
      "pose_mae_dtheta": 0.28018441796302795,
      "pose_mae_dx": 0.0900401771068573,
      "pose_mae_dy": 0.0671793669462204,
      "pose_rmse_dtheta": 0.520075261592865,
      "pose_rmse_dx": 0.2076898068189621,
      "pose_rmse_dy": 0.1589563488960266,
      "pose_rmse_mean": 0.2955738306045532,
      "rmse_dtheta": 0.055304672569036484,
      "rmse_dx": 0.024164969101548195,
      "rmse_dy": 0.00834114570170641,
      "rmse_mean": 0.029270265251398087,
      "rotation_flip": 0.012948207557201385,
      "sparse_tokens": 17817.0,
      "step": 4648,
      "turn_loss": 0.22705493867397308,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.21599145140308493,
      "grad_norm": 1.5459563732147217,
      "learning_rate": 6.823891487558163e-06,
      "loss": 0.319,
      "mae_dtheta": 0.030043069273233414,
      "mae_dx": 0.013227442279458046,
      "mae_dy": 0.006029090844094753,
      "pose_mae_dtheta": 0.23022501170635223,
      "pose_mae_dx": 0.0934009924530983,
      "pose_mae_dy": 0.08793332427740097,
      "pose_rmse_dtheta": 0.42830705642700195,
      "pose_rmse_dx": 0.21028561890125275,
      "pose_rmse_dy": 0.18752704560756683,
      "pose_rmse_mean": 0.275373250246048,
      "rmse_dtheta": 0.0463055856525898,
      "rmse_dx": 0.026655780151486397,
      "rmse_dy": 0.012341984547674656,
      "rmse_mean": 0.028434451669454575,
      "rotation_flip": 0.008670520037412643,
      "sparse_tokens": 12400.0,
      "step": 4649,
      "turn_loss": 0.2431395798921585,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.2160379111689277,
      "grad_norm": 0.38396361470222473,
      "learning_rate": 6.822660312963374e-06,
      "loss": 0.1129,
      "mae_dtheta": 0.03988128900527954,
      "mae_dx": 0.011459325440227985,
      "mae_dy": 0.003131464822217822,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3839636743068695,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.5431671142578,
      "model/head/act_norm_mean": 104.97474365234375,
      "model/head/act_norm_min": 65.42752075195312,
      "model/head/act_over_embed": 72.1396266269248,
      "model/head/grad_frac": 0.11884048581123352,
      "model/head/grad_norm": 0.045630428940057755,
      "model/head/grad_zero_frac": 0.0001986121351365,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6953369140625,
      "model/head/update_ratio": 0.0007824056665413082,
      "model/head/weight_delta": 8.025141716003418,
      "model/head/weight_delta_rel": 0.14078475534915924,
      "model/head/weight_norm": 58.3206787109375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41921064257621765,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41921064257621765,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41921064257621765,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2880854782902474,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12001693993806839,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04608214646577835,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014912831829860806,
      "model/modality_embedder.encoders.pose/weight_delta": 2.627643346786499,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08585330098867416,
      "model/modality_embedder.encoders.pose/weight_norm": 30.901002883911133,
      "model/modality_embedder/grad_frac": 0.12001693993806839,
      "model/modality_embedder/grad_norm": 0.04608214646577835,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0014912831829860806,
      "model/modality_embedder/weight_delta": 2.627643346786499,
      "model/modality_embedder/weight_delta_rel": 0.08585330098867416,
      "model/modality_embedder/weight_norm": 30.901002883911133,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 76.81434631347656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.117065042162697,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.242400169372559,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.886263522346967,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08241146802902222,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.031643010675907135,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011386817786842585,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.9446769952774048,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0708652064204216,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.789161682128906,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 77.93931579589844,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.946431671626986,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.592660903930664,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.456212034767546,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08762191981077194,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.033643633127212524,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011409332510083914,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.461102247238159,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08525450527667999,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.487817764282227,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.96595764160156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.556178695436508,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.223159790039062,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.562445260218528,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09526168555021286,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.036577027291059494,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012015304528176785,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.645106554031372,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08881772309541702,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.442031860351562,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.86819458007812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.42796378968254,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.78725528717041,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.848753500912547,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09939917922019958,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03816567361354828,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012835930101573467,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.257236957550049,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0771416500210762,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.733469009399414,
      "model/normalizer/grad_frac": 0.3933672606945038,
      "model/normalizer/grad_norm": 0.1510387361049652,
      "model/normalizer/grad_zero_frac": 0.0001985320559469983,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0019279852276667953,
      "model/normalizer/weight_delta": 4.792277812957764,
      "model/normalizer/weight_delta_rel": 0.061721764504909515,
      "model/normalizer/weight_norm": 78.34019470214844,
      "pose_mae_dtheta": 0.304025262594223,
      "pose_mae_dx": 0.0867718979716301,
      "pose_mae_dy": 0.03301544114947319,
      "pose_rmse_dtheta": 0.5321468710899353,
      "pose_rmse_dx": 0.18343038856983185,
      "pose_rmse_dy": 0.07051090896129608,
      "pose_rmse_mean": 0.26202940940856934,
      "rmse_dtheta": 0.0604068860411644,
      "rmse_dx": 0.023244734853506088,
      "rmse_dy": 0.005866586696356535,
      "rmse_mean": 0.029839402064681053,
      "rotation_flip": 0.01652892492711544,
      "sparse_tokens": 10407.0,
      "step": 4650,
      "turn_loss": 0.2323506623506546,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21608437093477048,
      "grad_norm": 0.5017958283424377,
      "learning_rate": 6.821429010908972e-06,
      "loss": 0.0875,
      "mae_dtheta": 0.008801444433629513,
      "mae_dx": 0.00207710824906826,
      "mae_dy": 0.0014812591252848506,
      "pose_mae_dtheta": 0.05866629257798195,
      "pose_mae_dx": 0.020068299025297165,
      "pose_mae_dy": 0.022316979244351387,
      "pose_rmse_dtheta": 0.1474338173866272,
      "pose_rmse_dx": 0.06693423539400101,
      "pose_rmse_dy": 0.05045939236879349,
      "pose_rmse_mean": 0.08827581256628036,
      "rmse_dtheta": 0.019555332139134407,
      "rmse_dx": 0.007764100097119808,
      "rmse_dy": 0.0030527287162840366,
      "rmse_mean": 0.010124053806066513,
      "rotation_flip": 0.003544303821399808,
      "sparse_tokens": 32073.0,
      "step": 4651,
      "turn_loss": 0.06680914014577866,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.21613083070061326,
      "grad_norm": 0.33739185333251953,
      "learning_rate": 6.820197581481061e-06,
      "loss": 0.0755,
      "mae_dtheta": 0.010897217318415642,
      "mae_dx": 0.002325869631022215,
      "mae_dy": 0.0032046802807599306,
      "pose_mae_dtheta": 0.07141681760549545,
      "pose_mae_dx": 0.029644904658198357,
      "pose_mae_dy": 0.030731551349163055,
      "pose_rmse_dtheta": 0.18119469285011292,
      "pose_rmse_dx": 0.07170212268829346,
      "pose_rmse_dy": 0.07257772237062454,
      "pose_rmse_mean": 0.10849151015281677,
      "rmse_dtheta": 0.02268850803375244,
      "rmse_dx": 0.006886009592562914,
      "rmse_dy": 0.006885923910886049,
      "rmse_mean": 0.01215348020195961,
      "rotation_flip": 0.004876462742686272,
      "sparse_tokens": 32121.0,
      "step": 4652,
      "turn_loss": 0.1006288081407547,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.21617729046645606,
      "grad_norm": 0.3742012083530426,
      "learning_rate": 6.818966024765758e-06,
      "loss": 0.1031,
      "mae_dtheta": 0.007455478422343731,
      "mae_dx": 0.0013217454543337226,
      "mae_dy": 0.0011880453675985336,
      "pose_mae_dtheta": 0.051756151020526886,
      "pose_mae_dx": 0.01519121415913105,
      "pose_mae_dy": 0.019334277138113976,
      "pose_rmse_dtheta": 0.1323590874671936,
      "pose_rmse_dx": 0.041823193430900574,
      "pose_rmse_dy": 0.05311243608593941,
      "pose_rmse_mean": 0.07576490938663483,
      "rmse_dtheta": 0.019674090668559074,
      "rmse_dx": 0.003988697659224272,
      "rmse_dy": 0.0029269056394696236,
      "rmse_mean": 0.008863232098519802,
      "rotation_flip": 0.005055611953139305,
      "sparse_tokens": 32121.0,
      "step": 4653,
      "turn_loss": 0.05101100727915764,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.21622375023229884,
      "grad_norm": 0.5026652812957764,
      "learning_rate": 6.817734340849184e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.013941982761025429,
      "mae_dx": 0.0016624674899503589,
      "mae_dy": 0.003526189597323537,
      "pose_mae_dtheta": 0.09995821863412857,
      "pose_mae_dx": 0.030800577253103256,
      "pose_mae_dy": 0.046409279108047485,
      "pose_rmse_dtheta": 0.20871908962726593,
      "pose_rmse_dx": 0.07596270740032196,
      "pose_rmse_dy": 0.10037901997566223,
      "pose_rmse_mean": 0.12835361063480377,
      "rmse_dtheta": 0.025981958955526352,
      "rmse_dx": 0.004764877259731293,
      "rmse_dy": 0.006854863837361336,
      "rmse_mean": 0.012533901259303093,
      "rotation_flip": 0.008288288488984108,
      "sparse_tokens": 32041.0,
      "step": 4654,
      "turn_loss": 0.0990561842918396,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21627020999814162,
      "grad_norm": 0.7070684432983398,
      "learning_rate": 6.8165025298174715e-06,
      "loss": 0.1879,
      "mae_dtheta": 0.013584154658019543,
      "mae_dx": 0.001790013164281845,
      "mae_dy": 0.003061364172026515,
      "pose_mae_dtheta": 0.0896163359284401,
      "pose_mae_dx": 0.025125063955783844,
      "pose_mae_dy": 0.034965939819812775,
      "pose_rmse_dtheta": 0.19892625510692596,
      "pose_rmse_dx": 0.05444800853729248,
      "pose_rmse_dy": 0.07529325783252716,
      "pose_rmse_mean": 0.10955584049224854,
      "rmse_dtheta": 0.024793095886707306,
      "rmse_dx": 0.004883165471255779,
      "rmse_dy": 0.005553117021918297,
      "rmse_mean": 0.011743126437067986,
      "rotation_flip": 0.009505080059170723,
      "sparse_tokens": 32105.0,
      "step": 4655,
      "turn_loss": 0.10776229202747345,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.2163166697639844,
      "grad_norm": 0.8844864368438721,
      "learning_rate": 6.815270591756762e-06,
      "loss": 0.2826,
      "mae_dtheta": 0.033143047243356705,
      "mae_dx": 0.009904863312840462,
      "mae_dy": 0.008276284672319889,
      "pose_mae_dtheta": 0.25402283668518066,
      "pose_mae_dx": 0.07468307763338089,
      "pose_mae_dy": 0.07912235707044601,
      "pose_rmse_dtheta": 0.41814374923706055,
      "pose_rmse_dx": 0.18049028515815735,
      "pose_rmse_dy": 0.18947698175907135,
      "pose_rmse_mean": 0.26270365715026855,
      "rmse_dtheta": 0.05058378353714943,
      "rmse_dx": 0.019871076568961143,
      "rmse_dy": 0.018258776515722275,
      "rmse_mean": 0.029571210965514183,
      "rotation_flip": 0.025316456332802773,
      "sparse_tokens": 12020.0,
      "step": 4656,
      "turn_loss": 0.3232882618904114,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.21636312952982717,
      "grad_norm": 0.8394136428833008,
      "learning_rate": 6.814038526753205e-06,
      "loss": 0.2515,
      "mae_dtheta": 0.03099001571536064,
      "mae_dx": 0.009843605570495129,
      "mae_dy": 0.006009894888848066,
      "pose_mae_dtheta": 0.26714423298835754,
      "pose_mae_dx": 0.07975639402866364,
      "pose_mae_dy": 0.06219633296132088,
      "pose_rmse_dtheta": 0.4243771433830261,
      "pose_rmse_dx": 0.17525874078273773,
      "pose_rmse_dy": 0.15431667864322662,
      "pose_rmse_mean": 0.2513175308704376,
      "rmse_dtheta": 0.04509492963552475,
      "rmse_dx": 0.019740181043744087,
      "rmse_dy": 0.013225083239376545,
      "rmse_mean": 0.02602006494998932,
      "rotation_flip": 0.011013215407729149,
      "sparse_tokens": 8016.0,
      "step": 4657,
      "turn_loss": 0.2422470599412918,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21640958929566995,
      "grad_norm": 0.580959141254425,
      "learning_rate": 6.8128063348929605e-06,
      "loss": 0.0816,
      "mae_dtheta": 0.00781991146504879,
      "mae_dx": 0.001239210949279368,
      "mae_dy": 0.0016161928651854396,
      "pose_mae_dtheta": 0.05777941644191742,
      "pose_mae_dx": 0.015591204166412354,
      "pose_mae_dy": 0.022948989644646645,
      "pose_rmse_dtheta": 0.15476050972938538,
      "pose_rmse_dx": 0.04541405290365219,
      "pose_rmse_dy": 0.06454447656869888,
      "pose_rmse_mean": 0.08823968470096588,
      "rmse_dtheta": 0.020393529906868935,
      "rmse_dx": 0.004358332604169846,
      "rmse_dy": 0.0043507954105734825,
      "rmse_mean": 0.009700885973870754,
      "rotation_flip": 0.0030196276493370533,
      "sparse_tokens": 32073.0,
      "step": 4658,
      "turn_loss": 0.06700622290372849,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21645604906151272,
      "grad_norm": 0.5703825950622559,
      "learning_rate": 6.811574016262196e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.009252921678125858,
      "mae_dx": 0.001652170903980732,
      "mae_dy": 0.0018367684679105878,
      "pose_mae_dtheta": 0.06499920040369034,
      "pose_mae_dx": 0.02152280882000923,
      "pose_mae_dy": 0.025955693796277046,
      "pose_rmse_dtheta": 0.16692037880420685,
      "pose_rmse_dx": 0.062066107988357544,
      "pose_rmse_dy": 0.05600309371948242,
      "pose_rmse_mean": 0.09499653428792953,
      "rmse_dtheta": 0.020972007885575294,
      "rmse_dx": 0.005600268486887217,
      "rmse_dy": 0.004106317646801472,
      "rmse_mean": 0.01022619754076004,
      "rotation_flip": 0.002314814832061529,
      "sparse_tokens": 32073.0,
      "step": 4659,
      "turn_loss": 0.07395067065954208,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2165025088273555,
      "grad_norm": 0.414543479681015,
      "learning_rate": 6.81034157094709e-06,
      "loss": 0.0901,
      "mae_dtheta": 0.009476407431066036,
      "mae_dx": 0.001961996778845787,
      "mae_dy": 0.0021960947196930647,
      "pose_mae_dtheta": 0.06744104623794556,
      "pose_mae_dx": 0.02336559258401394,
      "pose_mae_dy": 0.02769564650952816,
      "pose_rmse_dtheta": 0.16232886910438538,
      "pose_rmse_dx": 0.06101838871836662,
      "pose_rmse_dy": 0.07026752829551697,
      "pose_rmse_mean": 0.09787160158157349,
      "rmse_dtheta": 0.02177993766963482,
      "rmse_dx": 0.006131058093160391,
      "rmse_dy": 0.005835989024490118,
      "rmse_mean": 0.011248994618654251,
      "rotation_flip": 0.0067255147732794285,
      "sparse_tokens": 32105.0,
      "step": 4660,
      "turn_loss": 0.08275266736745834,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21654896859319828,
      "grad_norm": 0.48508161306381226,
      "learning_rate": 6.809108999033825e-06,
      "loss": 0.1428,
      "mae_dtheta": 0.01135182287544012,
      "mae_dx": 0.002186426892876625,
      "mae_dy": 0.003119328524917364,
      "pose_mae_dtheta": 0.080719955265522,
      "pose_mae_dx": 0.02720307558774948,
      "pose_mae_dy": 0.03365625441074371,
      "pose_rmse_dtheta": 0.18872661888599396,
      "pose_rmse_dx": 0.07516252994537354,
      "pose_rmse_dy": 0.08126575499773026,
      "pose_rmse_mean": 0.11505162715911865,
      "rmse_dtheta": 0.02381822280585766,
      "rmse_dx": 0.006175427231937647,
      "rmse_dy": 0.00706903263926506,
      "rmse_mean": 0.012354227714240551,
      "rotation_flip": 0.0054580895230174065,
      "sparse_tokens": 32105.0,
      "step": 4661,
      "turn_loss": 0.10874848067760468,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.21659542835904108,
      "grad_norm": 0.4573972523212433,
      "learning_rate": 6.807876300608597e-06,
      "loss": 0.0893,
      "mae_dtheta": 0.019087305292487144,
      "mae_dx": 0.0062243202701210976,
      "mae_dy": 0.0033257328905165195,
      "pose_mae_dtheta": 0.13540314137935638,
      "pose_mae_dx": 0.05894572660326958,
      "pose_mae_dy": 0.052453309297561646,
      "pose_rmse_dtheta": 0.28189581632614136,
      "pose_rmse_dx": 0.16988018155097961,
      "pose_rmse_dy": 0.10995303094387054,
      "pose_rmse_mean": 0.1872430145740509,
      "rmse_dtheta": 0.033797431737184525,
      "rmse_dx": 0.017788788303732872,
      "rmse_dy": 0.0059903464280068874,
      "rmse_mean": 0.01919218897819519,
      "rotation_flip": 0.004032257944345474,
      "sparse_tokens": 13287.0,
      "step": 4662,
      "turn_loss": 0.17087888717651367,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21664188812488386,
      "grad_norm": 0.5373192429542542,
      "learning_rate": 6.806643475757608e-06,
      "loss": 0.1747,
      "mae_dtheta": 0.016092147678136826,
      "mae_dx": 0.0036631659604609013,
      "mae_dy": 0.006773242261260748,
      "pose_mae_dtheta": 0.11395673453807831,
      "pose_mae_dx": 0.04816243052482605,
      "pose_mae_dy": 0.060482751578092575,
      "pose_rmse_dtheta": 0.2362746000289917,
      "pose_rmse_dx": 0.12624990940093994,
      "pose_rmse_dy": 0.1487281769514084,
      "pose_rmse_mean": 0.17041757702827454,
      "rmse_dtheta": 0.02913350984454155,
      "rmse_dx": 0.009006751701235771,
      "rmse_dy": 0.01390925981104374,
      "rmse_mean": 0.017349839210510254,
      "rotation_flip": 0.0119011290371418,
      "sparse_tokens": 32105.0,
      "step": 4663,
      "turn_loss": 0.1855401247739792,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.21668834789072663,
      "grad_norm": 0.5088079571723938,
      "learning_rate": 6.805410524567073e-06,
      "loss": 0.1504,
      "mae_dtheta": 0.024989616125822067,
      "mae_dx": 0.010427908040583134,
      "mae_dy": 0.005447291769087315,
      "pose_mae_dtheta": 0.19220781326293945,
      "pose_mae_dx": 0.08731644600629807,
      "pose_mae_dy": 0.07809742540121078,
      "pose_rmse_dtheta": 0.3633483946323395,
      "pose_rmse_dx": 0.20013396441936493,
      "pose_rmse_dy": 0.18005335330963135,
      "pose_rmse_mean": 0.24784523248672485,
      "rmse_dtheta": 0.04175134375691414,
      "rmse_dx": 0.023056576028466225,
      "rmse_dy": 0.011109240353107452,
      "rmse_mean": 0.025305721908807755,
      "rotation_flip": 0.006553079932928085,
      "sparse_tokens": 17077.0,
      "step": 4664,
      "turn_loss": 0.20916765928268433,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.2167348076565694,
      "grad_norm": 0.5655078887939453,
      "learning_rate": 6.80417744712321e-06,
      "loss": 0.1465,
      "mae_dtheta": 0.036489613354206085,
      "mae_dx": 0.01586986519396305,
      "mae_dy": 0.004159001633524895,
      "pose_mae_dtheta": 0.2705366909503937,
      "pose_mae_dx": 0.13455650210380554,
      "pose_mae_dy": 0.040631067007780075,
      "pose_rmse_dtheta": 0.5407808423042297,
      "pose_rmse_dx": 0.29549306631088257,
      "pose_rmse_dy": 0.1000949889421463,
      "pose_rmse_mean": 0.31212297081947327,
      "rmse_dtheta": 0.05769350379705429,
      "rmse_dx": 0.02977229468524456,
      "rmse_dy": 0.00940409954637289,
      "rmse_mean": 0.03228996694087982,
      "rotation_flip": 0.010282776318490505,
      "sparse_tokens": 6932.0,
      "step": 4665,
      "turn_loss": 0.3494536280632019,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2167812674224122,
      "grad_norm": 0.44922909140586853,
      "learning_rate": 6.802944243512249e-06,
      "loss": 0.1388,
      "mae_dtheta": 0.007711995858699083,
      "mae_dx": 0.0020266214851289988,
      "mae_dy": 0.0016823121113702655,
      "pose_mae_dtheta": 0.05609827861189842,
      "pose_mae_dx": 0.02242373488843441,
      "pose_mae_dy": 0.022198110818862915,
      "pose_rmse_dtheta": 0.12977343797683716,
      "pose_rmse_dx": 0.0638229250907898,
      "pose_rmse_dy": 0.05761698633432388,
      "pose_rmse_mean": 0.08373778313398361,
      "rmse_dtheta": 0.017028342932462692,
      "rmse_dx": 0.006790373008698225,
      "rmse_dy": 0.004045322071760893,
      "rmse_mean": 0.009288012981414795,
      "rotation_flip": 0.0018018018454313278,
      "sparse_tokens": 32121.0,
      "step": 4666,
      "turn_loss": 0.07593163847923279,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.21682772718825497,
      "grad_norm": 0.5106563568115234,
      "learning_rate": 6.80171091382043e-06,
      "loss": 0.1353,
      "mae_dtheta": 0.0102350739762187,
      "mae_dx": 0.001796241383999586,
      "mae_dy": 0.002040304010733962,
      "pose_mae_dtheta": 0.07337919622659683,
      "pose_mae_dx": 0.024232102558016777,
      "pose_mae_dy": 0.030292367562651634,
      "pose_rmse_dtheta": 0.18916526436805725,
      "pose_rmse_dx": 0.0727604478597641,
      "pose_rmse_dy": 0.07186536490917206,
      "pose_rmse_mean": 0.1112636923789978,
      "rmse_dtheta": 0.02209583669900894,
      "rmse_dx": 0.006620602682232857,
      "rmse_dy": 0.004184213001281023,
      "rmse_mean": 0.010966884903609753,
      "rotation_flip": 0.007075471803545952,
      "sparse_tokens": 32041.0,
      "step": 4667,
      "turn_loss": 0.07238315790891647,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.21687418695409774,
      "grad_norm": 0.6008735299110413,
      "learning_rate": 6.8004774581339995e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.025726810097694397,
      "mae_dx": 0.012306747026741505,
      "mae_dy": 0.003687553107738495,
      "pose_mae_dtheta": 0.2104790359735489,
      "pose_mae_dx": 0.10003736615180969,
      "pose_mae_dy": 0.07428989559412003,
      "pose_rmse_dtheta": 0.3752131760120392,
      "pose_rmse_dx": 0.2293892651796341,
      "pose_rmse_dy": 0.16802442073822021,
      "pose_rmse_mean": 0.25754231214523315,
      "rmse_dtheta": 0.0413682758808136,
      "rmse_dx": 0.025935987010598183,
      "rmse_dy": 0.00711092771962285,
      "rmse_mean": 0.024805065244436264,
      "rotation_flip": 0.015094339847564697,
      "sparse_tokens": 5092.0,
      "step": 4668,
      "turn_loss": 0.16470979154109955,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.21692064671994052,
      "grad_norm": 0.4842860996723175,
      "learning_rate": 6.799243876539213e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.011247175745666027,
      "mae_dx": 0.0023915579076856375,
      "mae_dy": 0.0032336104195564985,
      "pose_mae_dtheta": 0.0767286866903305,
      "pose_mae_dx": 0.02884019911289215,
      "pose_mae_dy": 0.029576020315289497,
      "pose_rmse_dtheta": 0.18187132477760315,
      "pose_rmse_dx": 0.0744020938873291,
      "pose_rmse_dy": 0.07019142806529999,
      "pose_rmse_mean": 0.10882161557674408,
      "rmse_dtheta": 0.025148820132017136,
      "rmse_dx": 0.006440032739192247,
      "rmse_dy": 0.008115616627037525,
      "rmse_mean": 0.013234823010861874,
      "rotation_flip": 0.00039999998989515007,
      "sparse_tokens": 32153.0,
      "step": 4669,
      "turn_loss": 0.10178036987781525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.21696710648578332,
      "grad_norm": 0.41179707646369934,
      "learning_rate": 6.798010169122338e-06,
      "loss": 0.0829,
      "mae_dtheta": 0.008871580474078655,
      "mae_dx": 0.0011920541292056441,
      "mae_dy": 0.001690034056082368,
      "pose_mae_dtheta": 0.060583606362342834,
      "pose_mae_dx": 0.015324595384299755,
      "pose_mae_dy": 0.02270328626036644,
      "pose_rmse_dtheta": 0.18680527806282043,
      "pose_rmse_dx": 0.04612834379076958,
      "pose_rmse_dy": 0.054378442466259,
      "pose_rmse_mean": 0.0957706868648529,
      "rmse_dtheta": 0.02310912311077118,
      "rmse_dx": 0.004069116432219744,
      "rmse_dy": 0.005320362281054258,
      "rmse_mean": 0.010832867585122585,
      "rotation_flip": 0.005005561746656895,
      "sparse_tokens": 32041.0,
      "step": 4670,
      "turn_loss": 0.07121430337429047,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22972.0,
      "epoch": 0.2170135662516261,
      "grad_norm": 0.7440677285194397,
      "learning_rate": 6.796776335969646e-06,
      "loss": 0.2074,
      "mae_dtheta": 0.038157977163791656,
      "mae_dx": 0.017141738906502724,
      "mae_dy": 0.006564151030033827,
      "pose_mae_dtheta": 0.31641334295272827,
      "pose_mae_dx": 0.14358896017074585,
      "pose_mae_dy": 0.07399448752403259,
      "pose_rmse_dtheta": 0.5421618223190308,
      "pose_rmse_dx": 0.30278655886650085,
      "pose_rmse_dy": 0.1950518786907196,
      "pose_rmse_mean": 0.34666678309440613,
      "rmse_dtheta": 0.057299643754959106,
      "rmse_dx": 0.031471170485019684,
      "rmse_dy": 0.014962085522711277,
      "rmse_mean": 0.0345776341855526,
      "rotation_flip": 0.01837524212896824,
      "sparse_tokens": 18764.0,
      "step": 4671,
      "turn_loss": 0.31313556432724,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21706002601746888,
      "grad_norm": 0.45271924138069153,
      "learning_rate": 6.7955423771674214e-06,
      "loss": 0.0836,
      "mae_dtheta": 0.007114064414054155,
      "mae_dx": 0.0009978170273825526,
      "mae_dy": 0.0013807860668748617,
      "pose_mae_dtheta": 0.04911204054951668,
      "pose_mae_dx": 0.011883295141160488,
      "pose_mae_dy": 0.019570160657167435,
      "pose_rmse_dtheta": 0.14874495565891266,
      "pose_rmse_dx": 0.03292420506477356,
      "pose_rmse_dy": 0.04580739140510559,
      "pose_rmse_mean": 0.0758255198597908,
      "rmse_dtheta": 0.017451243475079536,
      "rmse_dx": 0.003275217255577445,
      "rmse_dy": 0.003029534127563238,
      "rmse_mean": 0.007918665185570717,
      "rotation_flip": 0.0018656715983524919,
      "sparse_tokens": 32073.0,
      "step": 4672,
      "turn_loss": 0.05046238377690315,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.21710648578331165,
      "grad_norm": 0.537538468837738,
      "learning_rate": 6.794308292801954e-06,
      "loss": 0.0932,
      "mae_dtheta": 0.00864064134657383,
      "mae_dx": 0.0020770118571817875,
      "mae_dy": 0.0016326300101354718,
      "pose_mae_dtheta": 0.05999341234564781,
      "pose_mae_dx": 0.01679389365017414,
      "pose_mae_dy": 0.018628185614943504,
      "pose_rmse_dtheta": 0.16560746729373932,
      "pose_rmse_dx": 0.047940753400325775,
      "pose_rmse_dy": 0.044406913220882416,
      "pose_rmse_mean": 0.08598504960536957,
      "rmse_dtheta": 0.02198702283203602,
      "rmse_dx": 0.006580021232366562,
      "rmse_dy": 0.005030403379350901,
      "rmse_mean": 0.011199149303138256,
      "rotation_flip": 0.003189792623743415,
      "sparse_tokens": 32169.0,
      "step": 4673,
      "turn_loss": 0.07083442807197571,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21715294554915443,
      "grad_norm": 0.4026782214641571,
      "learning_rate": 6.793074082959545e-06,
      "loss": 0.098,
      "mae_dtheta": 0.00687383720651269,
      "mae_dx": 0.001407482079230249,
      "mae_dy": 0.0008847436401993036,
      "pose_mae_dtheta": 0.052174314856529236,
      "pose_mae_dx": 0.012498665601015091,
      "pose_mae_dy": 0.012149726040661335,
      "pose_rmse_dtheta": 0.19551463425159454,
      "pose_rmse_dx": 0.03897213190793991,
      "pose_rmse_dy": 0.03440867364406586,
      "pose_rmse_mean": 0.0896318182349205,
      "rmse_dtheta": 0.0234364103525877,
      "rmse_dx": 0.004708622116595507,
      "rmse_dy": 0.0023722148034721613,
      "rmse_mean": 0.010172415524721146,
      "rotation_flip": 0.0007674596854485571,
      "sparse_tokens": 32105.0,
      "step": 4674,
      "turn_loss": 0.043211646378040314,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.2171994053149972,
      "grad_norm": 0.3761325478553772,
      "learning_rate": 6.7918397477265e-06,
      "loss": 0.0908,
      "mae_dtheta": 0.03018360212445259,
      "mae_dx": 0.012884074822068214,
      "mae_dy": 0.002628885442391038,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.37613263726234436,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 154.49362182617188,
      "model/head/act_norm_mean": 113.941162109375,
      "model/head/act_norm_min": 73.45445251464844,
      "model/head/act_over_embed": 78.30143333552884,
      "model/head/grad_frac": 0.10399891436100006,
      "model/head/grad_norm": 0.03911738470196724,
      "model/head/grad_zero_frac": 0.00019829485972877592,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6853271484375,
      "model/head/update_ratio": 0.0006706751300953329,
      "model/head/weight_delta": 8.04683780670166,
      "model/head/weight_delta_rel": 0.1411653757095337,
      "model/head/weight_norm": 58.325382232666016,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4191778600215912,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4191778600215912,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4191778600215912,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.288062949811793,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10693299770355225,
      "model/modality_embedder.encoders.pose/grad_norm": 0.040220990777015686,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013015706790611148,
      "model/modality_embedder.encoders.pose/weight_delta": 2.632939577102661,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08602634072303772,
      "model/modality_embedder.encoders.pose/weight_norm": 30.901887893676758,
      "model/modality_embedder/grad_frac": 0.10693299770355225,
      "model/modality_embedder/grad_norm": 0.040220990777015686,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0013015706790611148,
      "model/modality_embedder/weight_delta": 2.632939577102661,
      "model/modality_embedder/weight_delta_rel": 0.08602634072303772,
      "model/modality_embedder/weight_norm": 30.901887893676758,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.0656967163086,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.962279885912697,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.1631441116333,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.467103075998008,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09369444102048874,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03524153679609299,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012681001098826528,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.95188570022583,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07112789154052734,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.790815353393555,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.71932220458984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.81940414186508,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.84668254852295,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.056126889212194,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0767354667186737,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.028862714767456055,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009787215385586023,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.470370292663574,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08557555824518204,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.490222930908203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.66600799560547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.498694816468255,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.328235626220703,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.210151162566493,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0744120255112648,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.027988791465759277,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009193558944389224,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.655093193054199,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.08915305882692337,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.44391441345215,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.17549896240234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.377120535714287,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.769803047180176,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.501022902931023,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07163747400045395,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.026945192366838455,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009061751188710332,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.2653799057006836,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0774199366569519,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.735082626342773,
      "model/normalizer/grad_frac": 0.36786630749702454,
      "model/normalizer/grad_norm": 0.13836652040481567,
      "model/normalizer/grad_zero_frac": 0.00019616857753135264,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017661647871136665,
      "model/normalizer/weight_delta": 4.810235977172852,
      "model/normalizer/weight_delta_rel": 0.06195305287837982,
      "model/normalizer/weight_norm": 78.34292602539062,
      "pose_mae_dtheta": 0.25407877564430237,
      "pose_mae_dx": 0.10061410069465637,
      "pose_mae_dy": 0.028811847791075706,
      "pose_rmse_dtheta": 0.489431232213974,
      "pose_rmse_dx": 0.24823904037475586,
      "pose_rmse_dy": 0.07362200319766998,
      "pose_rmse_mean": 0.2704307734966278,
      "rmse_dtheta": 0.04836226627230644,
      "rmse_dx": 0.027087947353720665,
      "rmse_dy": 0.005619853734970093,
      "rmse_mean": 0.027023356407880783,
      "rotation_flip": 0.005217391531914473,
      "sparse_tokens": 10735.0,
      "step": 4675,
      "turn_loss": 0.20515327155590057,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.21724586508083998,
      "grad_norm": 0.5124236941337585,
      "learning_rate": 6.790605287189143e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.008350343443453312,
      "mae_dx": 0.0020916007924824953,
      "mae_dy": 0.0016838114243000746,
      "pose_mae_dtheta": 0.05960797891020775,
      "pose_mae_dx": 0.02231823280453682,
      "pose_mae_dy": 0.023302223533391953,
      "pose_rmse_dtheta": 0.17165988683700562,
      "pose_rmse_dx": 0.07687858492136002,
      "pose_rmse_dy": 0.06056535616517067,
      "pose_rmse_mean": 0.103034608066082,
      "rmse_dtheta": 0.02127976343035698,
      "rmse_dx": 0.007933301851153374,
      "rmse_dy": 0.003934937063604593,
      "rmse_mean": 0.011049333959817886,
      "rotation_flip": 0.0026939655654132366,
      "sparse_tokens": 32073.0,
      "step": 4676,
      "turn_loss": 0.059736739844083786,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.21729232484668276,
      "grad_norm": 0.475279837846756,
      "learning_rate": 6.789370701433797e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.01881362311542034,
      "mae_dx": 0.004985908977687359,
      "mae_dy": 0.00261029158718884,
      "pose_mae_dtheta": 0.13943041861057281,
      "pose_mae_dx": 0.04786602407693863,
      "pose_mae_dy": 0.04068727791309357,
      "pose_rmse_dtheta": 0.22908850014209747,
      "pose_rmse_dx": 0.10678457468748093,
      "pose_rmse_dy": 0.09184680879116058,
      "pose_rmse_mean": 0.1425732970237732,
      "rmse_dtheta": 0.03259409964084625,
      "rmse_dx": 0.013607368804514408,
      "rmse_dy": 0.005143764428794384,
      "rmse_mean": 0.01711507886648178,
      "rotation_flip": 0.00319488812237978,
      "sparse_tokens": 5185.0,
      "step": 4677,
      "turn_loss": 0.14074423909187317,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.21733878461252557,
      "grad_norm": 0.42329666018486023,
      "learning_rate": 6.788135990546798e-06,
      "loss": 0.1803,
      "mae_dtheta": 0.006361605133861303,
      "mae_dx": 0.0017893643816933036,
      "mae_dy": 0.0008251977269537747,
      "pose_mae_dtheta": 0.045846257358789444,
      "pose_mae_dx": 0.01714729145169258,
      "pose_mae_dy": 0.013721837662160397,
      "pose_rmse_dtheta": 0.1576862931251526,
      "pose_rmse_dx": 0.04831092804670334,
      "pose_rmse_dy": 0.04380735009908676,
      "pose_rmse_mean": 0.0832681953907013,
      "rmse_dtheta": 0.021151700988411903,
      "rmse_dx": 0.005638820584863424,
      "rmse_dy": 0.0019271402852609754,
      "rmse_mean": 0.009572554379701614,
      "rotation_flip": 0.0020380434580147266,
      "sparse_tokens": 32121.0,
      "step": 4678,
      "turn_loss": 0.05709134787321091,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.21738524437836834,
      "grad_norm": 0.4788646101951599,
      "learning_rate": 6.7869011546144885e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.011904687620699406,
      "mae_dx": 0.002803461393341422,
      "mae_dy": 0.0030105735640972853,
      "pose_mae_dtheta": 0.08140315115451813,
      "pose_mae_dx": 0.03672678396105766,
      "pose_mae_dy": 0.03764820098876953,
      "pose_rmse_dtheta": 0.17748112976551056,
      "pose_rmse_dx": 0.10824252665042877,
      "pose_rmse_dy": 0.08221165090799332,
      "pose_rmse_mean": 0.12264510244131088,
      "rmse_dtheta": 0.024068431928753853,
      "rmse_dx": 0.009529163129627705,
      "rmse_dy": 0.006387888919562101,
      "rmse_mean": 0.013328495435416698,
      "rotation_flip": 0.0073149739764630795,
      "sparse_tokens": 32057.0,
      "step": 4679,
      "turn_loss": 0.11546025425195694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.21743170414421112,
      "grad_norm": 0.8045703172683716,
      "learning_rate": 6.785666193723222e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.009649007581174374,
      "mae_dx": 0.001697068102657795,
      "mae_dy": 0.0011229208903387189,
      "pose_mae_dtheta": 0.06606687605381012,
      "pose_mae_dx": 0.016956575214862823,
      "pose_mae_dy": 0.013784661889076233,
      "pose_rmse_dtheta": 0.23829109966754913,
      "pose_rmse_dx": 0.040320564061403275,
      "pose_rmse_dy": 0.03752043843269348,
      "pose_rmse_mean": 0.10537736862897873,
      "rmse_dtheta": 0.028926337137818336,
      "rmse_dx": 0.004827586933970451,
      "rmse_dy": 0.002809130819514394,
      "rmse_mean": 0.012187684886157513,
      "rotation_flip": 0.0020439447835087776,
      "sparse_tokens": 32153.0,
      "step": 4680,
      "turn_loss": 0.054241131991147995,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2174781639100539,
      "grad_norm": 0.43313130736351013,
      "learning_rate": 6.78443110795936e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.006712659727782011,
      "mae_dx": 0.0014055910287424922,
      "mae_dy": 0.0014432688476517797,
      "pose_mae_dtheta": 0.048083286732435226,
      "pose_mae_dx": 0.013141768053174019,
      "pose_mae_dy": 0.014718773774802685,
      "pose_rmse_dtheta": 0.15752576291561127,
      "pose_rmse_dx": 0.034376513212919235,
      "pose_rmse_dy": 0.03645353764295578,
      "pose_rmse_mean": 0.07611861079931259,
      "rmse_dtheta": 0.018559830263257027,
      "rmse_dx": 0.0040366495959460735,
      "rmse_dy": 0.004108608700335026,
      "rmse_mean": 0.008901696652173996,
      "rotation_flip": 0.0029510960448533297,
      "sparse_tokens": 32169.0,
      "step": 4681,
      "turn_loss": 0.049596529453992844,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.21752462367589667,
      "grad_norm": 0.54144287109375,
      "learning_rate": 6.783195897409274e-06,
      "loss": 0.1548,
      "mae_dtheta": 0.039900436997413635,
      "mae_dx": 0.008954266086220741,
      "mae_dy": 0.005246923305094242,
      "pose_mae_dtheta": 0.3439711034297943,
      "pose_mae_dx": 0.08538676053285599,
      "pose_mae_dy": 0.05162033438682556,
      "pose_rmse_dtheta": 0.5835142731666565,
      "pose_rmse_dx": 0.1829201728105545,
      "pose_rmse_dy": 0.1585330218076706,
      "pose_rmse_mean": 0.3083224892616272,
      "rmse_dtheta": 0.06054558604955673,
      "rmse_dx": 0.019893435761332512,
      "rmse_dy": 0.012616257183253765,
      "rmse_mean": 0.03101842664182186,
      "rotation_flip": 0.01795332133769989,
      "sparse_tokens": 7892.0,
      "step": 4682,
      "turn_loss": 0.3146490752696991,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.21757108344173945,
      "grad_norm": 0.550366997718811,
      "learning_rate": 6.78196056215934e-06,
      "loss": 0.0964,
      "mae_dtheta": 0.01108465250581503,
      "mae_dx": 0.0023139130789786577,
      "mae_dy": 0.0030256276950240135,
      "pose_mae_dtheta": 0.0795488953590393,
      "pose_mae_dx": 0.028337793424725533,
      "pose_mae_dy": 0.029118482023477554,
      "pose_rmse_dtheta": 0.20461907982826233,
      "pose_rmse_dx": 0.0754653587937355,
      "pose_rmse_dy": 0.06605089455842972,
      "pose_rmse_mean": 0.11537843942642212,
      "rmse_dtheta": 0.024720696732401848,
      "rmse_dx": 0.0066582574509084225,
      "rmse_dy": 0.008142306469380856,
      "rmse_mean": 0.013173754326999187,
      "rotation_flip": 0.004346251487731934,
      "sparse_tokens": 32121.0,
      "step": 4683,
      "turn_loss": 0.09779617190361023,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.21761754320758223,
      "grad_norm": 0.7572504281997681,
      "learning_rate": 6.780725102295949e-06,
      "loss": 0.1591,
      "mae_dtheta": 0.010130644775927067,
      "mae_dx": 0.002797979163005948,
      "mae_dy": 0.0039719888009130955,
      "pose_mae_dtheta": 0.07032624632120132,
      "pose_mae_dx": 0.03435061126947403,
      "pose_mae_dy": 0.031145956367254257,
      "pose_rmse_dtheta": 0.12723089754581451,
      "pose_rmse_dx": 0.08881434798240662,
      "pose_rmse_dy": 0.067837193608284,
      "pose_rmse_mean": 0.0946274846792221,
      "rmse_dtheta": 0.01842137984931469,
      "rmse_dx": 0.006869008298963308,
      "rmse_dy": 0.008636835031211376,
      "rmse_mean": 0.01130907516926527,
      "rotation_flip": 0.004763524979352951,
      "sparse_tokens": 32169.0,
      "step": 4684,
      "turn_loss": 0.11072968691587448,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.217664002973425,
      "grad_norm": 0.5325227975845337,
      "learning_rate": 6.779489517905494e-06,
      "loss": 0.0963,
      "mae_dtheta": 0.00947826262563467,
      "mae_dx": 0.001531708985567093,
      "mae_dy": 0.0019661840051412582,
      "pose_mae_dtheta": 0.06942809373140335,
      "pose_mae_dx": 0.020282814279198647,
      "pose_mae_dy": 0.02481619082391262,
      "pose_rmse_dtheta": 0.21526655554771423,
      "pose_rmse_dx": 0.05909076705574989,
      "pose_rmse_dy": 0.08890306204557419,
      "pose_rmse_mean": 0.12108679860830307,
      "rmse_dtheta": 0.025264151394367218,
      "rmse_dx": 0.005100918933749199,
      "rmse_dy": 0.005785029381513596,
      "rmse_mean": 0.012050032615661621,
      "rotation_flip": 0.0069755855947732925,
      "sparse_tokens": 32089.0,
      "step": 4685,
      "turn_loss": 0.06894026696681976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.2177104627392678,
      "grad_norm": 1.1132632493972778,
      "learning_rate": 6.778253809074384e-06,
      "loss": 0.2581,
      "mae_dtheta": 0.038942962884902954,
      "mae_dx": 0.009808361530303955,
      "mae_dy": 0.004975398536771536,
      "pose_mae_dtheta": 0.3154245913028717,
      "pose_mae_dx": 0.06990068405866623,
      "pose_mae_dy": 0.06396748125553131,
      "pose_rmse_dtheta": 0.5401830077171326,
      "pose_rmse_dx": 0.14623858034610748,
      "pose_rmse_dy": 0.1711144596338272,
      "pose_rmse_mean": 0.2858453392982483,
      "rmse_dtheta": 0.057449519634246826,
      "rmse_dx": 0.02033780701458454,
      "rmse_dy": 0.010010468773543835,
      "rmse_mean": 0.029265930876135826,
      "rotation_flip": 0.008695651777088642,
      "sparse_tokens": 13534.0,
      "step": 4686,
      "turn_loss": 0.2527070939540863,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 4252.0,
      "epoch": 0.21775692250511058,
      "grad_norm": 0.5793545246124268,
      "learning_rate": 6.77701797588903e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.04301060363650322,
      "mae_dx": 0.008339477702975273,
      "mae_dy": 0.004439839161932468,
      "pose_mae_dtheta": 0.3433692753314972,
      "pose_mae_dx": 0.0799022763967514,
      "pose_mae_dy": 0.06349537521600723,
      "pose_rmse_dtheta": 0.6342394351959229,
      "pose_rmse_dx": 0.19261454045772552,
      "pose_rmse_dy": 0.16890555620193481,
      "pose_rmse_mean": 0.3319198489189148,
      "rmse_dtheta": 0.06544908136129379,
      "rmse_dx": 0.020420368760824203,
      "rmse_dy": 0.008737542666494846,
      "rmse_mean": 0.031535662710666656,
      "rotation_flip": 0.0,
      "sparse_tokens": 3104.0,
      "step": 4687,
      "turn_loss": 0.215767040848732,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.21780338227095336,
      "grad_norm": 0.6160492300987244,
      "learning_rate": 6.775782018435854e-06,
      "loss": 0.1663,
      "mae_dtheta": 0.04800392687320709,
      "mae_dx": 0.008873227052390575,
      "mae_dy": 0.008301448076963425,
      "pose_mae_dtheta": 0.4129141569137573,
      "pose_mae_dx": 0.047628339380025864,
      "pose_mae_dy": 0.03983088210225105,
      "pose_rmse_dtheta": 0.6875472664833069,
      "pose_rmse_dx": 0.12639190256595612,
      "pose_rmse_dy": 0.11537525802850723,
      "pose_rmse_mean": 0.30977147817611694,
      "rmse_dtheta": 0.06939654052257538,
      "rmse_dx": 0.01974610611796379,
      "rmse_dy": 0.019633663818240166,
      "rmse_mean": 0.036258772015571594,
      "rotation_flip": 0.00401606410741806,
      "sparse_tokens": 4079.0,
      "step": 4688,
      "turn_loss": 0.3836698532104492,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.21784984203679614,
      "grad_norm": 0.5348235368728638,
      "learning_rate": 6.774545936801289e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.008012967184185982,
      "mae_dx": 0.002175938570871949,
      "mae_dy": 0.0017215596744790673,
      "pose_mae_dtheta": 0.058148887008428574,
      "pose_mae_dx": 0.020049242302775383,
      "pose_mae_dy": 0.018198346719145775,
      "pose_rmse_dtheta": 0.19065696001052856,
      "pose_rmse_dx": 0.06324736028909683,
      "pose_rmse_dy": 0.061028968542814255,
      "pose_rmse_mean": 0.10497775673866272,
      "rmse_dtheta": 0.022856365889310837,
      "rmse_dx": 0.0072858696803450584,
      "rmse_dy": 0.005497512873262167,
      "rmse_mean": 0.011879916302859783,
      "rotation_flip": 0.0026143791619688272,
      "sparse_tokens": 32169.0,
      "step": 4689,
      "turn_loss": 0.07396046817302704,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.21789630180263891,
      "grad_norm": 0.49562326073646545,
      "learning_rate": 6.773309731071774e-06,
      "loss": 0.1378,
      "mae_dtheta": 0.029788166284561157,
      "mae_dx": 0.009087243117392063,
      "mae_dy": 0.00598564837127924,
      "pose_mae_dtheta": 0.21232347190380096,
      "pose_mae_dx": 0.07976754009723663,
      "pose_mae_dy": 0.07181566208600998,
      "pose_rmse_dtheta": 0.368960976600647,
      "pose_rmse_dx": 0.1820775419473648,
      "pose_rmse_dy": 0.17350320518016815,
      "pose_rmse_mean": 0.2415139079093933,
      "rmse_dtheta": 0.04673733562231064,
      "rmse_dx": 0.020476674661040306,
      "rmse_dy": 0.013558379374444485,
      "rmse_mean": 0.0269241314381361,
      "rotation_flip": 0.0235294122248888,
      "sparse_tokens": 20696.0,
      "step": 4690,
      "turn_loss": 0.28111207485198975,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2179427615684817,
      "grad_norm": 0.6462810039520264,
      "learning_rate": 6.772073401333758e-06,
      "loss": 0.1253,
      "mae_dtheta": 0.006759127136319876,
      "mae_dx": 0.001379621447995305,
      "mae_dy": 0.0004514550673775375,
      "pose_mae_dtheta": 0.0491308830678463,
      "pose_mae_dx": 0.012395426630973816,
      "pose_mae_dy": 0.008507818914949894,
      "pose_rmse_dtheta": 0.19568541646003723,
      "pose_rmse_dx": 0.03407847136259079,
      "pose_rmse_dy": 0.025366241112351418,
      "pose_rmse_mean": 0.08504338562488556,
      "rmse_dtheta": 0.023994291201233864,
      "rmse_dx": 0.004282860085368156,
      "rmse_dy": 0.0010744896717369556,
      "rmse_mean": 0.009783880785107613,
      "rotation_flip": 0.004240282811224461,
      "sparse_tokens": 32137.0,
      "step": 4691,
      "turn_loss": 0.04156218096613884,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.21798922133432447,
      "grad_norm": 0.45274418592453003,
      "learning_rate": 6.770836947673698e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.00940162967890501,
      "mae_dx": 0.0015995159046724439,
      "mae_dy": 0.001999430125579238,
      "pose_mae_dtheta": 0.060804206877946854,
      "pose_mae_dx": 0.01805793307721615,
      "pose_mae_dy": 0.021414268761873245,
      "pose_rmse_dtheta": 0.14501523971557617,
      "pose_rmse_dx": 0.049408700317144394,
      "pose_rmse_dy": 0.05383288487792015,
      "pose_rmse_mean": 0.0827522799372673,
      "rmse_dtheta": 0.022698188200592995,
      "rmse_dx": 0.004921029321849346,
      "rmse_dy": 0.0053880224004387856,
      "rmse_mean": 0.011002412997186184,
      "rotation_flip": 0.0026555387303233147,
      "sparse_tokens": 32153.0,
      "step": 4692,
      "turn_loss": 0.07351271063089371,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.21803568110016724,
      "grad_norm": 0.7283018231391907,
      "learning_rate": 6.76960037017806e-06,
      "loss": 0.1417,
      "mae_dtheta": 0.04481291025876999,
      "mae_dx": 0.010381011292338371,
      "mae_dy": 0.0016381656751036644,
      "pose_mae_dtheta": 0.400972843170166,
      "pose_mae_dx": 0.07778175175189972,
      "pose_mae_dy": 0.024497540667653084,
      "pose_rmse_dtheta": 0.7501606941223145,
      "pose_rmse_dx": 0.18700052797794342,
      "pose_rmse_dy": 0.06000088155269623,
      "pose_rmse_mean": 0.33238738775253296,
      "rmse_dtheta": 0.06940330564975739,
      "rmse_dx": 0.022386088967323303,
      "rmse_dy": 0.0032327231019735336,
      "rmse_mean": 0.03167404234409332,
      "rotation_flip": 0.023668639361858368,
      "sparse_tokens": 3710.0,
      "step": 4693,
      "turn_loss": 0.21706987917423248,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.21808214086601005,
      "grad_norm": 0.759311854839325,
      "learning_rate": 6.768363668933318e-06,
      "loss": 0.1475,
      "mae_dtheta": 0.013440492562949657,
      "mae_dx": 0.0021705497056245804,
      "mae_dy": 0.0028992665465921164,
      "pose_mae_dtheta": 0.09617368131875992,
      "pose_mae_dx": 0.027837008237838745,
      "pose_mae_dy": 0.031054656952619553,
      "pose_rmse_dtheta": 0.2615264654159546,
      "pose_rmse_dx": 0.06784465909004211,
      "pose_rmse_dy": 0.06660141050815582,
      "pose_rmse_mean": 0.13199084997177124,
      "rmse_dtheta": 0.031108308583498,
      "rmse_dx": 0.005908253137022257,
      "rmse_dy": 0.006881066132336855,
      "rmse_mean": 0.014632543548941612,
      "rotation_flip": 0.004253810737282038,
      "sparse_tokens": 32121.0,
      "step": 4694,
      "turn_loss": 0.12005012482404709,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21812860063185283,
      "grad_norm": 0.4301729202270508,
      "learning_rate": 6.767126844025955e-06,
      "loss": 0.0923,
      "mae_dtheta": 0.010182141326367855,
      "mae_dx": 0.0013116009067744017,
      "mae_dy": 0.0015477229608222842,
      "pose_mae_dtheta": 0.06336840242147446,
      "pose_mae_dx": 0.015860090032219887,
      "pose_mae_dy": 0.02394593134522438,
      "pose_rmse_dtheta": 0.18267954885959625,
      "pose_rmse_dx": 0.03639800101518631,
      "pose_rmse_dy": 0.05068133771419525,
      "pose_rmse_mean": 0.08991962671279907,
      "rmse_dtheta": 0.023481503129005432,
      "rmse_dx": 0.0041280509904026985,
      "rmse_dy": 0.0027596752624958754,
      "rmse_mean": 0.010123075917363167,
      "rotation_flip": 0.0038714671973139048,
      "sparse_tokens": 32089.0,
      "step": 4695,
      "turn_loss": 0.07550515234470367,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.2181750603976956,
      "grad_norm": 0.4313918352127075,
      "learning_rate": 6.765889895542465e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.03647670894861221,
      "mae_dx": 0.014398274943232536,
      "mae_dy": 0.006137444172054529,
      "pose_mae_dtheta": 0.2812615931034088,
      "pose_mae_dx": 0.12293203920125961,
      "pose_mae_dy": 0.0691278949379921,
      "pose_rmse_dtheta": 0.5022528171539307,
      "pose_rmse_dx": 0.27407461404800415,
      "pose_rmse_dy": 0.14271198213100433,
      "pose_rmse_mean": 0.30634647607803345,
      "rmse_dtheta": 0.05452318117022514,
      "rmse_dx": 0.027646655216813087,
      "rmse_dy": 0.011600395664572716,
      "rmse_mean": 0.031256746500730515,
      "rotation_flip": 0.018472906202077866,
      "sparse_tokens": 13831.0,
      "step": 4696,
      "turn_loss": 0.2715855538845062,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21822152016353838,
      "grad_norm": 0.35755494236946106,
      "learning_rate": 6.7646528235693445e-06,
      "loss": 0.0934,
      "mae_dtheta": 0.0059287287294864655,
      "mae_dx": 0.001197400619275868,
      "mae_dy": 0.0015635452000424266,
      "pose_mae_dtheta": 0.03921157866716385,
      "pose_mae_dx": 0.01514128316193819,
      "pose_mae_dy": 0.019652551040053368,
      "pose_rmse_dtheta": 0.07853510975837708,
      "pose_rmse_dx": 0.03643152117729187,
      "pose_rmse_dy": 0.04624444618821144,
      "pose_rmse_mean": 0.05373702570796013,
      "rmse_dtheta": 0.012681468389928341,
      "rmse_dx": 0.0035258596763014793,
      "rmse_dy": 0.003464376786723733,
      "rmse_mean": 0.006557235028594732,
      "rotation_flip": 0.0036815463099628687,
      "sparse_tokens": 32089.0,
      "step": 4697,
      "turn_loss": 0.05147070810198784,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.21826797992938116,
      "grad_norm": 0.583932101726532,
      "learning_rate": 6.763415628193106e-06,
      "loss": 0.1585,
      "mae_dtheta": 0.02766868658363819,
      "mae_dx": 0.007641092874109745,
      "mae_dy": 0.005817719269543886,
      "pose_mae_dtheta": 0.2118448168039322,
      "pose_mae_dx": 0.06633263826370239,
      "pose_mae_dy": 0.07091667503118515,
      "pose_rmse_dtheta": 0.42759016156196594,
      "pose_rmse_dx": 0.1585710495710373,
      "pose_rmse_dy": 0.16820330917835236,
      "pose_rmse_mean": 0.25145483016967773,
      "rmse_dtheta": 0.04625607281923294,
      "rmse_dx": 0.018828313797712326,
      "rmse_dy": 0.013557465746998787,
      "rmse_mean": 0.02621394954621792,
      "rotation_flip": 0.011591148562729359,
      "sparse_tokens": 21108.0,
      "step": 4698,
      "turn_loss": 0.21346348524093628,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.21831443969522393,
      "grad_norm": 0.3827664852142334,
      "learning_rate": 6.762178309500267e-06,
      "loss": 0.0883,
      "mae_dtheta": 0.007956008426845074,
      "mae_dx": 0.0019132581073790789,
      "mae_dy": 0.0007428688695654273,
      "pose_mae_dtheta": 0.059290386736392975,
      "pose_mae_dx": 0.017215970903635025,
      "pose_mae_dy": 0.009561965242028236,
      "pose_rmse_dtheta": 0.20259906351566315,
      "pose_rmse_dx": 0.04467054829001427,
      "pose_rmse_dy": 0.033596400171518326,
      "pose_rmse_mean": 0.09362201392650604,
      "rmse_dtheta": 0.025144416838884354,
      "rmse_dx": 0.005389786791056395,
      "rmse_dy": 0.0028996372129768133,
      "rmse_mean": 0.011144613847136497,
      "rotation_flip": 0.0027262812945991755,
      "sparse_tokens": 32217.0,
      "step": 4699,
      "turn_loss": 0.054176874458789825,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2183608994610667,
      "grad_norm": 0.7392683029174805,
      "learning_rate": 6.760940867577352e-06,
      "loss": 0.1735,
      "mae_dtheta": 0.010539678856730461,
      "mae_dx": 0.0014739750185981393,
      "mae_dy": 0.002647570800036192,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7392682433128357,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.9901580810547,
      "model/head/act_norm_mean": 115.39043757891415,
      "model/head/act_norm_min": 63.657283782958984,
      "model/head/act_over_embed": 79.29738900652686,
      "model/head/grad_frac": 0.10935802757740021,
      "model/head/grad_norm": 0.08084491640329361,
      "model/head/grad_zero_frac": 0.0001583186094649136,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6936454387626263,
      "model/head/update_ratio": 0.001386001124046743,
      "model/head/weight_delta": 8.065654754638672,
      "model/head/weight_delta_rel": 0.141495481133461,
      "model/head/weight_norm": 58.329620361328125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4191631078720093,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4190983837006858,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4190383553504944,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2880083329399978,
      "model/modality_embedder.encoders.pose/grad_frac": 0.03474092110991478,
      "model/modality_embedder.encoders.pose/grad_norm": 0.025682859122753143,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5485806702488688,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0008310905541293323,
      "model/modality_embedder.encoders.pose/weight_delta": 2.63804030418396,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08619299530982971,
      "model/modality_embedder.encoders.pose/weight_norm": 30.902599334716797,
      "model/modality_embedder/grad_frac": 0.03474092110991478,
      "model/modality_embedder/grad_norm": 0.025682859122753143,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5485806702488688,
      "model/modality_embedder/update_ratio": 0.0008310905541293323,
      "model/modality_embedder/weight_delta": 2.63804030418396,
      "model/modality_embedder/weight_delta_rel": 0.08619299530982971,
      "model/modality_embedder/weight_norm": 30.902599334716797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.62964630126953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.129704785954786,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.141495704650879,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.58215903476354,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07824108004570007,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05784114450216293,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020811951253563166,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.9585721492767334,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07137154787778854,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.792274475097656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.4708251953125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.168793590668592,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.276277542114258,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.296230589465527,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0785566121339798,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05807441100478172,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001969102770090103,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.47876238822937,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08586626499891281,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.492828369140625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.20967864990234,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.059115460157127,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.271092414855957,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.595277475650217,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07721573859453201,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.057083144783973694,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018748727161437273,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.6648290157318115,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0894799679517746,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.4464111328125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.95045471191406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.885642135642136,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.317642211914062,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.85048370725567,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07785121351480484,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05755292996764183,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019353737588971853,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.2729251384735107,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07767779380083084,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.73737144470215,
      "model/normalizer/grad_frac": 0.32283273339271545,
      "model/normalizer/grad_norm": 0.23865999281406403,
      "model/normalizer/grad_zero_frac": 0.00020444074471015483,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003046237165108323,
      "model/normalizer/weight_delta": 4.8269476890563965,
      "model/normalizer/weight_delta_rel": 0.062168292701244354,
      "model/normalizer/weight_norm": 78.34583282470703,
      "pose_mae_dtheta": 0.06624196469783783,
      "pose_mae_dx": 0.02857537753880024,
      "pose_mae_dy": 0.034704215824604034,
      "pose_rmse_dtheta": 0.1414572149515152,
      "pose_rmse_dx": 0.06647667288780212,
      "pose_rmse_dy": 0.07299795746803284,
      "pose_rmse_mean": 0.09364394843578339,
      "rmse_dtheta": 0.02045671083033085,
      "rmse_dx": 0.0036674682050943375,
      "rmse_dy": 0.005359697621315718,
      "rmse_mean": 0.009827959351241589,
      "rotation_flip": 0.0011600927682593465,
      "sparse_tokens": 32089.0,
      "step": 4700,
      "turn_loss": 0.09152829647064209,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2184073592269095,
      "grad_norm": 0.5637065768241882,
      "learning_rate": 6.759703302510898e-06,
      "loss": 0.1132,
      "mae_dtheta": 0.011487326584756374,
      "mae_dx": 0.0024148477241396904,
      "mae_dy": 0.0029922262765467167,
      "pose_mae_dtheta": 0.07587172836065292,
      "pose_mae_dx": 0.030801884829998016,
      "pose_mae_dy": 0.033837005496025085,
      "pose_rmse_dtheta": 0.16348707675933838,
      "pose_rmse_dx": 0.07897044718265533,
      "pose_rmse_dy": 0.07695110887289047,
      "pose_rmse_mean": 0.1064695417881012,
      "rmse_dtheta": 0.022552458569407463,
      "rmse_dx": 0.006877015344798565,
      "rmse_dy": 0.006062210071831942,
      "rmse_mean": 0.011830560863018036,
      "rotation_flip": 0.006217277608811855,
      "sparse_tokens": 32153.0,
      "step": 4701,
      "turn_loss": 0.0881308764219284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21845381899275226,
      "grad_norm": 0.5450462102890015,
      "learning_rate": 6.758465614387446e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.009571718983352184,
      "mae_dx": 0.0027538216672837734,
      "mae_dy": 0.002434523543342948,
      "pose_mae_dtheta": 0.07652322202920914,
      "pose_mae_dx": 0.026251163333654404,
      "pose_mae_dy": 0.031499285250902176,
      "pose_rmse_dtheta": 0.20214995741844177,
      "pose_rmse_dx": 0.07103122770786285,
      "pose_rmse_dy": 0.08501818031072617,
      "pose_rmse_mean": 0.11939980089664459,
      "rmse_dtheta": 0.022610830143094063,
      "rmse_dx": 0.008750022388994694,
      "rmse_dy": 0.0060077547095716,
      "rmse_mean": 0.012456202879548073,
      "rotation_flip": 0.009924385696649551,
      "sparse_tokens": 32089.0,
      "step": 4702,
      "turn_loss": 0.08306938409805298,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.21850027875859507,
      "grad_norm": 0.5717588663101196,
      "learning_rate": 6.757227803293552e-06,
      "loss": 0.1842,
      "mae_dtheta": 0.03963426128029823,
      "mae_dx": 0.01260405033826828,
      "mae_dy": 0.005426198709756136,
      "pose_mae_dtheta": 0.31020960211753845,
      "pose_mae_dx": 0.1020083874464035,
      "pose_mae_dy": 0.06321534514427185,
      "pose_rmse_dtheta": 0.49373772740364075,
      "pose_rmse_dx": 0.21088957786560059,
      "pose_rmse_dy": 0.1361578106880188,
      "pose_rmse_mean": 0.28026169538497925,
      "rmse_dtheta": 0.05696447938680649,
      "rmse_dx": 0.025030190125107765,
      "rmse_dy": 0.009616261348128319,
      "rmse_mean": 0.03053697757422924,
      "rotation_flip": 0.013944223523139954,
      "sparse_tokens": 8715.0,
      "step": 4703,
      "turn_loss": 0.2943597137928009,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.21854673852443784,
      "grad_norm": 1.2503876686096191,
      "learning_rate": 6.755989869315772e-06,
      "loss": 0.2615,
      "mae_dtheta": 0.025022048503160477,
      "mae_dx": 0.0037453332915902138,
      "mae_dy": 0.003379326080903411,
      "pose_mae_dtheta": 0.2162315398454666,
      "pose_mae_dx": 0.03445485979318619,
      "pose_mae_dy": 0.036155663430690765,
      "pose_rmse_dtheta": 0.5055385828018188,
      "pose_rmse_dx": 0.09076491743326187,
      "pose_rmse_dy": 0.08125825226306915,
      "pose_rmse_mean": 0.22585391998291016,
      "rmse_dtheta": 0.04754875972867012,
      "rmse_dx": 0.0101896608248353,
      "rmse_dy": 0.00696335406973958,
      "rmse_mean": 0.02156725898385048,
      "rotation_flip": 0.014218009077012539,
      "sparse_tokens": 3827.0,
      "step": 4704,
      "turn_loss": 0.13734635710716248,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.21859319829028062,
      "grad_norm": 0.5129860043525696,
      "learning_rate": 6.75475181254068e-06,
      "loss": 0.111,
      "mae_dtheta": 0.03674038127064705,
      "mae_dx": 0.014573872089385986,
      "mae_dy": 0.006833598017692566,
      "pose_mae_dtheta": 0.2585159242153168,
      "pose_mae_dx": 0.14530357718467712,
      "pose_mae_dy": 0.060763198882341385,
      "pose_rmse_dtheta": 0.4293370246887207,
      "pose_rmse_dx": 0.28210946917533875,
      "pose_rmse_dy": 0.10742248594760895,
      "pose_rmse_mean": 0.27295634150505066,
      "rmse_dtheta": 0.05366979539394379,
      "rmse_dx": 0.027282750234007835,
      "rmse_dy": 0.012164046987891197,
      "rmse_mean": 0.031038865447044373,
      "rotation_flip": 0.007425742689520121,
      "sparse_tokens": 6906.0,
      "step": 4705,
      "turn_loss": 0.3883775472640991,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.2186396580561234,
      "grad_norm": 1.2155460119247437,
      "learning_rate": 6.75351363305485e-06,
      "loss": 0.3144,
      "mae_dtheta": 0.031204696744680405,
      "mae_dx": 0.006004441995173693,
      "mae_dy": 0.005151566583663225,
      "pose_mae_dtheta": 0.26111915707588196,
      "pose_mae_dx": 0.055354148149490356,
      "pose_mae_dy": 0.03689950704574585,
      "pose_rmse_dtheta": 0.43541422486305237,
      "pose_rmse_dx": 0.11319480836391449,
      "pose_rmse_dy": 0.08348136395215988,
      "pose_rmse_mean": 0.21069680154323578,
      "rmse_dtheta": 0.047095995396375656,
      "rmse_dx": 0.011578095145523548,
      "rmse_dy": 0.011348875239491463,
      "rmse_mean": 0.023340988904237747,
      "rotation_flip": 0.011111111380159855,
      "sparse_tokens": 4493.0,
      "step": 4706,
      "turn_loss": 0.24170154333114624,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.21868611782196617,
      "grad_norm": 0.4927983582019806,
      "learning_rate": 6.752275330944871e-06,
      "loss": 0.078,
      "mae_dtheta": 0.010546100325882435,
      "mae_dx": 0.001646067714318633,
      "mae_dy": 0.0023849939461797476,
      "pose_mae_dtheta": 0.07191591709852219,
      "pose_mae_dx": 0.023080110549926758,
      "pose_mae_dy": 0.030766600742936134,
      "pose_rmse_dtheta": 0.16296784579753876,
      "pose_rmse_dx": 0.062066707760095596,
      "pose_rmse_dy": 0.06953323632478714,
      "pose_rmse_mean": 0.09818926453590393,
      "rmse_dtheta": 0.022219330072402954,
      "rmse_dx": 0.005198072176426649,
      "rmse_dy": 0.005933091975748539,
      "rmse_mean": 0.011116831563413143,
      "rotation_flip": 0.001792114693671465,
      "sparse_tokens": 32057.0,
      "step": 4707,
      "turn_loss": 0.0856403112411499,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.21873257758780895,
      "grad_norm": 0.5227038860321045,
      "learning_rate": 6.751036906297338e-06,
      "loss": 0.1739,
      "mae_dtheta": 0.03227069973945618,
      "mae_dx": 0.014463423751294613,
      "mae_dy": 0.00370132178068161,
      "pose_mae_dtheta": 0.272638201713562,
      "pose_mae_dx": 0.12626256048679352,
      "pose_mae_dy": 0.044805824756622314,
      "pose_rmse_dtheta": 0.4938311278820038,
      "pose_rmse_dx": 0.2545730471611023,
      "pose_rmse_dy": 0.09215755015611649,
      "pose_rmse_mean": 0.2801872491836548,
      "rmse_dtheta": 0.051923077553510666,
      "rmse_dx": 0.02614041417837143,
      "rmse_dy": 0.006673769559711218,
      "rmse_mean": 0.028245752677321434,
      "rotation_flip": 0.006410256493836641,
      "sparse_tokens": 10958.0,
      "step": 4708,
      "turn_loss": 0.24152590334415436,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.21877903735365173,
      "grad_norm": 0.6415785551071167,
      "learning_rate": 6.7497983591988535e-06,
      "loss": 0.1777,
      "mae_dtheta": 0.03593412786722183,
      "mae_dx": 0.012138227932155132,
      "mae_dy": 0.009356477297842503,
      "pose_mae_dtheta": 0.2742132246494293,
      "pose_mae_dx": 0.09676629304885864,
      "pose_mae_dy": 0.11362580209970474,
      "pose_rmse_dtheta": 0.43614059686660767,
      "pose_rmse_dx": 0.24151118099689484,
      "pose_rmse_dy": 0.24633803963661194,
      "pose_rmse_mean": 0.30799660086631775,
      "rmse_dtheta": 0.05075550451874733,
      "rmse_dx": 0.026300949975848198,
      "rmse_dy": 0.01602081023156643,
      "rmse_mean": 0.031025756150484085,
      "rotation_flip": 0.017142856493592262,
      "sparse_tokens": 9674.0,
      "step": 4709,
      "turn_loss": 0.3136257827281952,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2188254971194945,
      "grad_norm": 0.5777618885040283,
      "learning_rate": 6.748559689736032e-06,
      "loss": 0.1158,
      "mae_dtheta": 0.014998924918472767,
      "mae_dx": 0.0026304495986551046,
      "mae_dy": 0.0037998296320438385,
      "pose_mae_dtheta": 0.10376570373773575,
      "pose_mae_dx": 0.03795582801103592,
      "pose_mae_dy": 0.04637946933507919,
      "pose_rmse_dtheta": 0.22637975215911865,
      "pose_rmse_dx": 0.09603501856327057,
      "pose_rmse_dy": 0.10888943076133728,
      "pose_rmse_mean": 0.1437680721282959,
      "rmse_dtheta": 0.027860842645168304,
      "rmse_dx": 0.008044423535466194,
      "rmse_dy": 0.007893402129411697,
      "rmse_mean": 0.014599556103348732,
      "rotation_flip": 0.009104704484343529,
      "sparse_tokens": 32057.0,
      "step": 4710,
      "turn_loss": 0.15686072409152985,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32764.0,
      "epoch": 0.2188719568853373,
      "grad_norm": 0.5660279989242554,
      "learning_rate": 6.747320897995493e-06,
      "loss": 0.1723,
      "mae_dtheta": 0.03651417791843414,
      "mae_dx": 0.012713450938463211,
      "mae_dy": 0.0053039370104670525,
      "pose_mae_dtheta": 0.2909444272518158,
      "pose_mae_dx": 0.10942261666059494,
      "pose_mae_dy": 0.06651928275823593,
      "pose_rmse_dtheta": 0.5090439319610596,
      "pose_rmse_dx": 0.24467457830905914,
      "pose_rmse_dy": 0.15026284754276276,
      "pose_rmse_mean": 0.301327109336853,
      "rmse_dtheta": 0.054909512400627136,
      "rmse_dx": 0.02576594054698944,
      "rmse_dy": 0.010910406708717346,
      "rmse_mean": 0.03052861988544464,
      "rotation_flip": 0.010909090749919415,
      "sparse_tokens": 24779.0,
      "step": 4711,
      "turn_loss": 0.28426092863082886,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.2189184166511801,
      "grad_norm": 0.503121018409729,
      "learning_rate": 6.746081984063865e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.043869491666555405,
      "mae_dx": 0.01193617470562458,
      "mae_dy": 0.005467643961310387,
      "pose_mae_dtheta": 0.3283090889453888,
      "pose_mae_dx": 0.08711618185043335,
      "pose_mae_dy": 0.06800662726163864,
      "pose_rmse_dtheta": 0.5551757216453552,
      "pose_rmse_dx": 0.1878373920917511,
      "pose_rmse_dy": 0.15347005426883698,
      "pose_rmse_mean": 0.29882773756980896,
      "rmse_dtheta": 0.06221116706728935,
      "rmse_dx": 0.02358306758105755,
      "rmse_dy": 0.010359594598412514,
      "rmse_mean": 0.03205127641558647,
      "rotation_flip": 0.016913319006562233,
      "sparse_tokens": 15025.0,
      "step": 4712,
      "turn_loss": 0.3093065023422241,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.21896487641702286,
      "grad_norm": 0.8801202774047852,
      "learning_rate": 6.744842948027787e-06,
      "loss": 0.2017,
      "mae_dtheta": 0.012762704864144325,
      "mae_dx": 0.002645677188411355,
      "mae_dy": 0.0027772150933742523,
      "pose_mae_dtheta": 0.0912255048751831,
      "pose_mae_dx": 0.030864425003528595,
      "pose_mae_dy": 0.04200616478919983,
      "pose_rmse_dtheta": 0.2108856439590454,
      "pose_rmse_dx": 0.08080700039863586,
      "pose_rmse_dy": 0.09576375037431717,
      "pose_rmse_mean": 0.12915213406085968,
      "rmse_dtheta": 0.02557673305273056,
      "rmse_dx": 0.008655675686895847,
      "rmse_dy": 0.006112008821219206,
      "rmse_mean": 0.013448139652609825,
      "rotation_flip": 0.004592422395944595,
      "sparse_tokens": 32057.0,
      "step": 4713,
      "turn_loss": 0.1321999728679657,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.21901133618286564,
      "grad_norm": 0.417113333940506,
      "learning_rate": 6.743603789973903e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.009050773456692696,
      "mae_dx": 0.0019624296110123396,
      "mae_dy": 0.0019941257778555155,
      "pose_mae_dtheta": 0.05770467594265938,
      "pose_mae_dx": 0.021449383348226547,
      "pose_mae_dy": 0.02364409528672695,
      "pose_rmse_dtheta": 0.15643341839313507,
      "pose_rmse_dx": 0.046179596334695816,
      "pose_rmse_dy": 0.047745540738105774,
      "pose_rmse_mean": 0.08345285058021545,
      "rmse_dtheta": 0.02186545915901661,
      "rmse_dx": 0.004873494617640972,
      "rmse_dy": 0.004272725898772478,
      "rmse_mean": 0.0103372260928154,
      "rotation_flip": 0.004848937038332224,
      "sparse_tokens": 32153.0,
      "step": 4714,
      "turn_loss": 0.0828433483839035,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.21905779594870842,
      "grad_norm": 0.4732539653778076,
      "learning_rate": 6.742364509988873e-06,
      "loss": 0.1165,
      "mae_dtheta": 0.01581789366900921,
      "mae_dx": 0.0025131534785032272,
      "mae_dy": 0.0035473727621138096,
      "pose_mae_dtheta": 0.10862171649932861,
      "pose_mae_dx": 0.03382036089897156,
      "pose_mae_dy": 0.042050838470458984,
      "pose_rmse_dtheta": 0.24363864958286285,
      "pose_rmse_dx": 0.07751835882663727,
      "pose_rmse_dy": 0.08457684516906738,
      "pose_rmse_mean": 0.13524462282657623,
      "rmse_dtheta": 0.030957529321312904,
      "rmse_dx": 0.006661532912403345,
      "rmse_dy": 0.007232824340462685,
      "rmse_mean": 0.014950628392398357,
      "rotation_flip": 0.010621177963912487,
      "sparse_tokens": 32137.0,
      "step": 4715,
      "turn_loss": 0.13064655661582947,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.2191042557145512,
      "grad_norm": 0.3487457036972046,
      "learning_rate": 6.741125108159356e-06,
      "loss": 0.1223,
      "mae_dtheta": 0.02892310731112957,
      "mae_dx": 0.010588251054286957,
      "mae_dy": 0.0049065109342336655,
      "pose_mae_dtheta": 0.20765690505504608,
      "pose_mae_dx": 0.08441615104675293,
      "pose_mae_dy": 0.07945310324430466,
      "pose_rmse_dtheta": 0.35900363326072693,
      "pose_rmse_dx": 0.1700490564107895,
      "pose_rmse_dy": 0.18044404685497284,
      "pose_rmse_mean": 0.23649892210960388,
      "rmse_dtheta": 0.04627281799912453,
      "rmse_dx": 0.022843992337584496,
      "rmse_dy": 0.008419380523264408,
      "rmse_mean": 0.025845397263765335,
      "rotation_flip": 0.012903225608170033,
      "sparse_tokens": 6102.0,
      "step": 4716,
      "turn_loss": 0.23162482678890228,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.21915071548039397,
      "grad_norm": 0.5582329630851746,
      "learning_rate": 6.739885584572026e-06,
      "loss": 0.1458,
      "mae_dtheta": 0.024849388748407364,
      "mae_dx": 0.010474910959601402,
      "mae_dy": 0.003179218154400587,
      "pose_mae_dtheta": 0.1924767643213272,
      "pose_mae_dx": 0.07987428456544876,
      "pose_mae_dy": 0.05101525038480759,
      "pose_rmse_dtheta": 0.42803090810775757,
      "pose_rmse_dx": 0.21128100156784058,
      "pose_rmse_dy": 0.10011445730924606,
      "pose_rmse_mean": 0.2464754581451416,
      "rmse_dtheta": 0.047018494457006454,
      "rmse_dx": 0.024834096431732178,
      "rmse_dy": 0.005285836756229401,
      "rmse_mean": 0.025712810456752777,
      "rotation_flip": 0.004807692486792803,
      "sparse_tokens": 4521.0,
      "step": 4717,
      "turn_loss": 0.1533742994070053,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21919717524623675,
      "grad_norm": 0.519676148891449,
      "learning_rate": 6.738645939313564e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.010876991786062717,
      "mae_dx": 0.0021440195851027966,
      "mae_dy": 0.002397862495854497,
      "pose_mae_dtheta": 0.08007849752902985,
      "pose_mae_dx": 0.023405421525239944,
      "pose_mae_dy": 0.024656234309077263,
      "pose_rmse_dtheta": 0.25165221095085144,
      "pose_rmse_dx": 0.06300992518663406,
      "pose_rmse_dy": 0.06044592335820198,
      "pose_rmse_mean": 0.12503603100776672,
      "rmse_dtheta": 0.02744087390601635,
      "rmse_dx": 0.006395977456122637,
      "rmse_dy": 0.006249240133911371,
      "rmse_mean": 0.013362031430006027,
      "rotation_flip": 0.004672897048294544,
      "sparse_tokens": 32105.0,
      "step": 4718,
      "turn_loss": 0.09418154507875443,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21924363501207955,
      "grad_norm": 0.46598368883132935,
      "learning_rate": 6.737406172470657e-06,
      "loss": 0.1151,
      "mae_dtheta": 0.01022639311850071,
      "mae_dx": 0.0016719632549211383,
      "mae_dy": 0.0018275990150868893,
      "pose_mae_dtheta": 0.06930318474769592,
      "pose_mae_dx": 0.018303344026207924,
      "pose_mae_dy": 0.023410489782691002,
      "pose_rmse_dtheta": 0.1800304353237152,
      "pose_rmse_dx": 0.045376669615507126,
      "pose_rmse_dy": 0.05801796913146973,
      "pose_rmse_mean": 0.09447503089904785,
      "rmse_dtheta": 0.02400950901210308,
      "rmse_dx": 0.0046796659007668495,
      "rmse_dy": 0.004188891965895891,
      "rmse_mean": 0.010959356091916561,
      "rotation_flip": 0.0035035035107284784,
      "sparse_tokens": 32105.0,
      "step": 4719,
      "turn_loss": 0.07200136035680771,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.21929009477792233,
      "grad_norm": 0.5063491463661194,
      "learning_rate": 6.736166284130006e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.029171423986554146,
      "mae_dx": 0.007854302413761616,
      "mae_dy": 0.0036237589083611965,
      "pose_mae_dtheta": 0.21563297510147095,
      "pose_mae_dx": 0.06611741334199905,
      "pose_mae_dy": 0.04848736897110939,
      "pose_rmse_dtheta": 0.42231300473213196,
      "pose_rmse_dx": 0.15996314585208893,
      "pose_rmse_dy": 0.10985438525676727,
      "pose_rmse_mean": 0.2307101935148239,
      "rmse_dtheta": 0.047394055873155594,
      "rmse_dx": 0.018783243373036385,
      "rmse_dy": 0.007882274687290192,
      "rmse_mean": 0.024686526507139206,
      "rotation_flip": 0.017068272456526756,
      "sparse_tokens": 20564.0,
      "step": 4720,
      "turn_loss": 0.19776244461536407,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 8139.0,
      "epoch": 0.2193365545437651,
      "grad_norm": 0.5155702233314514,
      "learning_rate": 6.734926274378313e-06,
      "loss": 0.096,
      "mae_dtheta": 0.031062496826052666,
      "mae_dx": 0.006945483852177858,
      "mae_dy": 0.004078426863998175,
      "pose_mae_dtheta": 0.2584104835987091,
      "pose_mae_dx": 0.057991109788417816,
      "pose_mae_dy": 0.04095589742064476,
      "pose_rmse_dtheta": 0.4564705789089203,
      "pose_rmse_dx": 0.1369846761226654,
      "pose_rmse_dy": 0.08322275429964066,
      "pose_rmse_mean": 0.22555933892726898,
      "rmse_dtheta": 0.04731561616063118,
      "rmse_dx": 0.015679214149713516,
      "rmse_dy": 0.00807503703981638,
      "rmse_mean": 0.023689955472946167,
      "rotation_flip": 0.01044386439025402,
      "sparse_tokens": 6506.0,
      "step": 4721,
      "turn_loss": 0.23186653852462769,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.21938301430960788,
      "grad_norm": 0.4803105592727661,
      "learning_rate": 6.733686143302295e-06,
      "loss": 0.1175,
      "mae_dtheta": 0.007519555743783712,
      "mae_dx": 0.0015385935548692942,
      "mae_dy": 0.0017109556356444955,
      "pose_mae_dtheta": 0.05190549045801163,
      "pose_mae_dx": 0.018847210332751274,
      "pose_mae_dy": 0.020753372460603714,
      "pose_rmse_dtheta": 0.13580062985420227,
      "pose_rmse_dx": 0.04716578871011734,
      "pose_rmse_dy": 0.05602716654539108,
      "pose_rmse_mean": 0.07966452836990356,
      "rmse_dtheta": 0.01935141533613205,
      "rmse_dx": 0.004196361172944307,
      "rmse_dy": 0.004162714350968599,
      "rmse_mean": 0.009236830286681652,
      "rotation_flip": 0.0020764118526130915,
      "sparse_tokens": 32137.0,
      "step": 4722,
      "turn_loss": 0.07270736992359161,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21942947407545066,
      "grad_norm": 0.3806528151035309,
      "learning_rate": 6.732445890988675e-06,
      "loss": 0.1037,
      "mae_dtheta": 0.008742031641304493,
      "mae_dx": 0.0018505020998418331,
      "mae_dy": 0.0025828166399151087,
      "pose_mae_dtheta": 0.05930469185113907,
      "pose_mae_dx": 0.023913463577628136,
      "pose_mae_dy": 0.027079304680228233,
      "pose_rmse_dtheta": 0.1348683387041092,
      "pose_rmse_dx": 0.06967250257730484,
      "pose_rmse_dy": 0.05726088583469391,
      "pose_rmse_mean": 0.08726724237203598,
      "rmse_dtheta": 0.01797611080110073,
      "rmse_dx": 0.005137287080287933,
      "rmse_dy": 0.005799813661724329,
      "rmse_mean": 0.009637737646698952,
      "rotation_flip": 0.001973944017663598,
      "sparse_tokens": 32105.0,
      "step": 4723,
      "turn_loss": 0.07596535980701447,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.21947593384129344,
      "grad_norm": 0.5504843592643738,
      "learning_rate": 6.731205517524183e-06,
      "loss": 0.1273,
      "mae_dtheta": 0.010604701936244965,
      "mae_dx": 0.0019462399650365114,
      "mae_dy": 0.002821048954501748,
      "pose_mae_dtheta": 0.07167873531579971,
      "pose_mae_dx": 0.03036027029156685,
      "pose_mae_dy": 0.02944297343492508,
      "pose_rmse_dtheta": 0.1717340648174286,
      "pose_rmse_dx": 0.08075860142707825,
      "pose_rmse_dy": 0.06732138991355896,
      "pose_rmse_mean": 0.1066046878695488,
      "rmse_dtheta": 0.022377872839570045,
      "rmse_dx": 0.005564787890762091,
      "rmse_dy": 0.006102012936025858,
      "rmse_mean": 0.011348225176334381,
      "rotation_flip": 0.006524575874209404,
      "sparse_tokens": 32057.0,
      "step": 4724,
      "turn_loss": 0.08766897022724152,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2195223936071362,
      "grad_norm": 0.6401530504226685,
      "learning_rate": 6.7299650229955605e-06,
      "loss": 0.1084,
      "mae_dtheta": 0.0066264052875339985,
      "mae_dx": 0.0017060261452570558,
      "mae_dy": 0.0010445843217894435,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6401531100273132,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.75244140625,
      "model/head/act_norm_mean": 125.89673098169192,
      "model/head/act_norm_min": 66.66024017333984,
      "model/head/act_over_embed": 86.51741219438429,
      "model/head/grad_frac": 0.09481333941221237,
      "model/head/grad_norm": 0.06069505587220192,
      "model/head/grad_zero_frac": 0.00015927042113617063,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6907946654040404,
      "model/head/update_ratio": 0.0010404677595943213,
      "model/head/weight_delta": 8.08570384979248,
      "model/head/weight_delta_rel": 0.14184719324111938,
      "model/head/weight_norm": 58.33439254760742,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41911786794662476,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41905205853507244,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4189847409725189,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28797649785248525,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07676336914300919,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04914030805230141,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5483587043991416,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001590091735124588,
      "model/modality_embedder.encoders.pose/weight_delta": 2.6441142559051514,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08639145642518997,
      "model/modality_embedder.encoders.pose/weight_norm": 30.904071807861328,
      "model/modality_embedder/grad_frac": 0.07676336914300919,
      "model/modality_embedder/grad_norm": 0.04914030805230141,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5483587043991416,
      "model/modality_embedder/update_ratio": 0.001590091735124588,
      "model/modality_embedder/weight_delta": 2.6441142559051514,
      "model/modality_embedder/weight_delta_rel": 0.08639145642518997,
      "model/modality_embedder/weight_norm": 30.904071807861328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.55023193359375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.120748657206992,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.075753211975098,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.26321366138696,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0589921809732914,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03776402771472931,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013587420107796788,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.9652695655822754,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07161560654640198,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.793376922607422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.45222473144531,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.188607303190636,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.452052116394043,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.997056120357076,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06286228448152542,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.040241487324237823,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013643791899085045,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.4875564575195312,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08617089688777924,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.49435806274414,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.95687866210938,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.0634945687029,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.510438919067383,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.285496202188234,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06934709846973419,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04439276084303856,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014579526614397764,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.6751506328582764,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0898265466094017,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.448698043823242,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.57447814941406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.80164241622575,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.487049102783203,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.47996767580247,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0707605853676796,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04529760777950287,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015231785364449024,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.281085252761841,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0779566690325737,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.738868713378906,
      "model/normalizer/grad_frac": 0.2582419514656067,
      "model/normalizer/grad_norm": 0.16531439125537872,
      "model/normalizer/grad_zero_frac": 0.00019616857753135264,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021100067533552647,
      "model/normalizer/weight_delta": 4.844540596008301,
      "model/normalizer/weight_delta_rel": 0.062394879758358,
      "model/normalizer/weight_norm": 78.3478012084961,
      "pose_mae_dtheta": 0.046149324625730515,
      "pose_mae_dx": 0.01735602505505085,
      "pose_mae_dy": 0.0140869515016675,
      "pose_rmse_dtheta": 0.14736315608024597,
      "pose_rmse_dx": 0.04257794842123985,
      "pose_rmse_dy": 0.03766164183616638,
      "pose_rmse_mean": 0.07586758583784103,
      "rmse_dtheta": 0.018698453903198242,
      "rmse_dx": 0.004792507737874985,
      "rmse_dy": 0.002756051253527403,
      "rmse_mean": 0.008749004453420639,
      "rotation_flip": 0.002812939463183284,
      "sparse_tokens": 32185.0,
      "step": 4725,
      "turn_loss": 0.05573233217000961,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.219568853372979,
      "grad_norm": 0.7095547914505005,
      "learning_rate": 6.728724407489554e-06,
      "loss": 0.1696,
      "mae_dtheta": 0.01488027535378933,
      "mae_dx": 0.0021987762302160263,
      "mae_dy": 0.0035704015754163265,
      "pose_mae_dtheta": 0.10307738929986954,
      "pose_mae_dx": 0.03425106033682823,
      "pose_mae_dy": 0.04513879492878914,
      "pose_rmse_dtheta": 0.24222798645496368,
      "pose_rmse_dx": 0.08952635526657104,
      "pose_rmse_dy": 0.09782908856868744,
      "pose_rmse_mean": 0.14319448173046112,
      "rmse_dtheta": 0.029187988489866257,
      "rmse_dx": 0.006476007401943207,
      "rmse_dy": 0.007641643285751343,
      "rmse_mean": 0.014435213059186935,
      "rotation_flip": 0.010687566362321377,
      "sparse_tokens": 32089.0,
      "step": 4726,
      "turn_loss": 0.11372987926006317,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.2196153131388218,
      "grad_norm": 0.5262587070465088,
      "learning_rate": 6.727483671092922e-06,
      "loss": 0.0768,
      "mae_dtheta": 0.025266008451581,
      "mae_dx": 0.013643452897667885,
      "mae_dy": 0.0023309967946261168,
      "pose_mae_dtheta": 0.18759885430335999,
      "pose_mae_dx": 0.1042323112487793,
      "pose_mae_dy": 0.025924695655703545,
      "pose_rmse_dtheta": 0.3226379156112671,
      "pose_rmse_dx": 0.23373228311538696,
      "pose_rmse_dy": 0.06219397485256195,
      "pose_rmse_mean": 0.20618806779384613,
      "rmse_dtheta": 0.038570623844861984,
      "rmse_dx": 0.0255286768078804,
      "rmse_dy": 0.004867035895586014,
      "rmse_mean": 0.022988777607679367,
      "rotation_flip": 0.01744186133146286,
      "sparse_tokens": 5767.0,
      "step": 4727,
      "turn_loss": 0.24442742764949799,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21966177290466457,
      "grad_norm": 0.5165528655052185,
      "learning_rate": 6.726242813892432e-06,
      "loss": 0.1399,
      "mae_dtheta": 0.01055132132023573,
      "mae_dx": 0.0017974157817661762,
      "mae_dy": 0.0028448929078876972,
      "pose_mae_dtheta": 0.06474211066961288,
      "pose_mae_dx": 0.02828039601445198,
      "pose_mae_dy": 0.033503420650959015,
      "pose_rmse_dtheta": 0.12166094034910202,
      "pose_rmse_dx": 0.06785129755735397,
      "pose_rmse_dy": 0.07669592648744583,
      "pose_rmse_mean": 0.08873605728149414,
      "rmse_dtheta": 0.018962964415550232,
      "rmse_dx": 0.004702634643763304,
      "rmse_dy": 0.005675594788044691,
      "rmse_mean": 0.009780398570001125,
      "rotation_flip": 0.007243990898132324,
      "sparse_tokens": 32105.0,
      "step": 4728,
      "turn_loss": 0.08810164034366608,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21970823267050735,
      "grad_norm": 0.5683938264846802,
      "learning_rate": 6.725001835974854e-06,
      "loss": 0.2124,
      "mae_dtheta": 0.011416738852858543,
      "mae_dx": 0.0016494088340550661,
      "mae_dy": 0.0026624950114637613,
      "pose_mae_dtheta": 0.07797116041183472,
      "pose_mae_dx": 0.02539493516087532,
      "pose_mae_dy": 0.030210409313440323,
      "pose_rmse_dtheta": 0.17643247544765472,
      "pose_rmse_dx": 0.06800975650548935,
      "pose_rmse_dy": 0.06911571323871613,
      "pose_rmse_mean": 0.1045193076133728,
      "rmse_dtheta": 0.022958574816584587,
      "rmse_dx": 0.004649893846362829,
      "rmse_dy": 0.005401180125772953,
      "rmse_mean": 0.011003216728568077,
      "rotation_flip": 0.0022839740850031376,
      "sparse_tokens": 32089.0,
      "step": 4729,
      "turn_loss": 0.08908827602863312,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.21975469243635012,
      "grad_norm": 0.5361199378967285,
      "learning_rate": 6.723760737426972e-06,
      "loss": 0.1904,
      "mae_dtheta": 0.039246607571840286,
      "mae_dx": 0.011003110557794571,
      "mae_dy": 0.00401854095980525,
      "pose_mae_dtheta": 0.3432108759880066,
      "pose_mae_dx": 0.08565113693475723,
      "pose_mae_dy": 0.03699418157339096,
      "pose_rmse_dtheta": 0.5772234201431274,
      "pose_rmse_dx": 0.1973668932914734,
      "pose_rmse_dy": 0.10811347514390945,
      "pose_rmse_mean": 0.29423460364341736,
      "rmse_dtheta": 0.058129020035266876,
      "rmse_dx": 0.022275399416685104,
      "rmse_dy": 0.010708028450608253,
      "rmse_mean": 0.030370814725756645,
      "rotation_flip": 0.013104838319122791,
      "sparse_tokens": 15812.0,
      "step": 4730,
      "turn_loss": 0.29896068572998047,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 1017.0,
      "epoch": 0.2198011522021929,
      "grad_norm": 0.7940194010734558,
      "learning_rate": 6.722519518335576e-06,
      "loss": 0.1396,
      "mae_dtheta": 0.04109819605946541,
      "mae_dx": 0.046407025307416916,
      "mae_dy": 0.014241517521440983,
      "pose_mae_dtheta": 0.20459023118019104,
      "pose_mae_dx": 0.27801427245140076,
      "pose_mae_dy": 0.18923866748809814,
      "pose_rmse_dtheta": 0.27083155512809753,
      "pose_rmse_dx": 0.41057729721069336,
      "pose_rmse_dy": 0.28383615612983704,
      "pose_rmse_mean": 0.3217483460903168,
      "rmse_dtheta": 0.05161463841795921,
      "rmse_dx": 0.05547269433736801,
      "rmse_dy": 0.015494036488234997,
      "rmse_mean": 0.040860455483198166,
      "rotation_flip": 0.06666667014360428,
      "sparse_tokens": 901.0,
      "step": 4731,
      "turn_loss": 0.36207136511802673,
      "turns": 3.0,
      "turns_per_sample": 3.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.21984761196803568,
      "grad_norm": 0.5738985538482666,
      "learning_rate": 6.721278178787467e-06,
      "loss": 0.1755,
      "mae_dtheta": 0.03698405623435974,
      "mae_dx": 0.010841221548616886,
      "mae_dy": 0.006422828882932663,
      "pose_mae_dtheta": 0.27454668283462524,
      "pose_mae_dx": 0.07820083200931549,
      "pose_mae_dy": 0.06420155614614487,
      "pose_rmse_dtheta": 0.49270719289779663,
      "pose_rmse_dx": 0.1772993803024292,
      "pose_rmse_dy": 0.1296105533838272,
      "pose_rmse_mean": 0.2665390372276306,
      "rmse_dtheta": 0.054496653378009796,
      "rmse_dx": 0.022388894110918045,
      "rmse_dy": 0.013748396188020706,
      "rmse_mean": 0.03021131455898285,
      "rotation_flip": 0.017269736155867577,
      "sparse_tokens": 20440.0,
      "step": 4732,
      "turn_loss": 0.31470903754234314,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.21989407173387845,
      "grad_norm": 0.5261383056640625,
      "learning_rate": 6.720036718869449e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.01111440360546112,
      "mae_dx": 0.002783179050311446,
      "mae_dy": 0.003052991582080722,
      "pose_mae_dtheta": 0.08030320703983307,
      "pose_mae_dx": 0.028308864682912827,
      "pose_mae_dy": 0.030395133420825005,
      "pose_rmse_dtheta": 0.1791599541902542,
      "pose_rmse_dx": 0.07835886627435684,
      "pose_rmse_dy": 0.06546082347631454,
      "pose_rmse_mean": 0.10765989124774933,
      "rmse_dtheta": 0.023005573078989983,
      "rmse_dx": 0.008453644812107086,
      "rmse_dy": 0.007348836399614811,
      "rmse_mean": 0.012936018407344818,
      "rotation_flip": 0.005090054590255022,
      "sparse_tokens": 32105.0,
      "step": 4733,
      "turn_loss": 0.10497076064348221,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.21994053149972123,
      "grad_norm": 0.5765830874443054,
      "learning_rate": 6.718795138668341e-06,
      "loss": 0.1666,
      "mae_dtheta": 0.014370660297572613,
      "mae_dx": 0.0020115647930651903,
      "mae_dy": 0.0037090161349624395,
      "pose_mae_dtheta": 0.10207760334014893,
      "pose_mae_dx": 0.03332918882369995,
      "pose_mae_dy": 0.04282132536172867,
      "pose_rmse_dtheta": 0.24156367778778076,
      "pose_rmse_dx": 0.0823807343840599,
      "pose_rmse_dy": 0.09522061794996262,
      "pose_rmse_mean": 0.13972169160842896,
      "rmse_dtheta": 0.029363030567765236,
      "rmse_dx": 0.005044057499617338,
      "rmse_dy": 0.007389104925096035,
      "rmse_mean": 0.013932064175605774,
      "rotation_flip": 0.004669540096074343,
      "sparse_tokens": 32089.0,
      "step": 4734,
      "turn_loss": 0.12037599086761475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.219986991265564,
      "grad_norm": 0.4420836269855499,
      "learning_rate": 6.717553438270966e-06,
      "loss": 0.0923,
      "mae_dtheta": 0.008298192173242569,
      "mae_dx": 0.0013060288038104773,
      "mae_dy": 0.0014397205086424947,
      "pose_mae_dtheta": 0.04839102178812027,
      "pose_mae_dx": 0.01409169565886259,
      "pose_mae_dy": 0.020046304911375046,
      "pose_rmse_dtheta": 0.1287992000579834,
      "pose_rmse_dx": 0.03319505229592323,
      "pose_rmse_dy": 0.04483213648200035,
      "pose_rmse_mean": 0.068942129611969,
      "rmse_dtheta": 0.019729992374777794,
      "rmse_dx": 0.004294299986213446,
      "rmse_dy": 0.002753620967268944,
      "rmse_mean": 0.008925971575081348,
      "rotation_flip": 0.003938730806112289,
      "sparse_tokens": 32089.0,
      "step": 4735,
      "turn_loss": 0.05934973433613777,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.2200334510314068,
      "grad_norm": 0.43340247869491577,
      "learning_rate": 6.716311617764159e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.02952415682375431,
      "mae_dx": 0.008298611268401146,
      "mae_dy": 0.004320358857512474,
      "pose_mae_dtheta": 0.2212124466896057,
      "pose_mae_dx": 0.04926968365907669,
      "pose_mae_dy": 0.04766220599412918,
      "pose_rmse_dtheta": 0.3784155249595642,
      "pose_rmse_dx": 0.12218806147575378,
      "pose_rmse_dy": 0.10112462192773819,
      "pose_rmse_mean": 0.2005760669708252,
      "rmse_dtheta": 0.04597729444503784,
      "rmse_dx": 0.018419180065393448,
      "rmse_dy": 0.009502625092864037,
      "rmse_mean": 0.024633033201098442,
      "rotation_flip": 0.010020039975643158,
      "sparse_tokens": 8732.0,
      "step": 4736,
      "turn_loss": 0.23482412099838257,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.2200799107972496,
      "grad_norm": 0.7178526520729065,
      "learning_rate": 6.715069677234758e-06,
      "loss": 0.195,
      "mae_dtheta": 0.041969578713178635,
      "mae_dx": 0.01241043210029602,
      "mae_dy": 0.005690924823284149,
      "pose_mae_dtheta": 0.35432612895965576,
      "pose_mae_dx": 0.10627491772174835,
      "pose_mae_dy": 0.08336430788040161,
      "pose_rmse_dtheta": 0.6305390000343323,
      "pose_rmse_dx": 0.22053779661655426,
      "pose_rmse_dy": 0.17504651844501495,
      "pose_rmse_mean": 0.34204110503196716,
      "rmse_dtheta": 0.0625803992152214,
      "rmse_dx": 0.024210967123508453,
      "rmse_dy": 0.011019932106137276,
      "rmse_mean": 0.03260376676917076,
      "rotation_flip": 0.016393441706895828,
      "sparse_tokens": 10682.0,
      "step": 4737,
      "turn_loss": 0.2953115701675415,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.22012637056309237,
      "grad_norm": 0.5921287536621094,
      "learning_rate": 6.7138276167696135e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.01246130745857954,
      "mae_dx": 0.004140535835176706,
      "mae_dy": 0.0023827357217669487,
      "pose_mae_dtheta": 0.09221247583627701,
      "pose_mae_dx": 0.03931329771876335,
      "pose_mae_dy": 0.02990444004535675,
      "pose_rmse_dtheta": 0.2347460240125656,
      "pose_rmse_dx": 0.12153535336256027,
      "pose_rmse_dy": 0.07499656826257706,
      "pose_rmse_mean": 0.14375931024551392,
      "rmse_dtheta": 0.02817174792289734,
      "rmse_dx": 0.012699302285909653,
      "rmse_dy": 0.0067640976049005985,
      "rmse_mean": 0.015878383070230484,
      "rotation_flip": 0.007476635742932558,
      "sparse_tokens": 32089.0,
      "step": 4738,
      "turn_loss": 0.11238401383161545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.22017283032893514,
      "grad_norm": 0.5276877880096436,
      "learning_rate": 6.712585436455584e-06,
      "loss": 0.1288,
      "mae_dtheta": 0.02950378693640232,
      "mae_dx": 0.00794424582272768,
      "mae_dy": 0.004545819479972124,
      "pose_mae_dtheta": 0.22760513424873352,
      "pose_mae_dx": 0.06718955188989639,
      "pose_mae_dy": 0.047163136303424835,
      "pose_rmse_dtheta": 0.4670562148094177,
      "pose_rmse_dx": 0.1705525517463684,
      "pose_rmse_dy": 0.10479409992694855,
      "pose_rmse_mean": 0.24746762216091156,
      "rmse_dtheta": 0.050735827535390854,
      "rmse_dx": 0.01891041360795498,
      "rmse_dy": 0.01037796214222908,
      "rmse_mean": 0.026674732565879822,
      "rotation_flip": 0.016355140134692192,
      "sparse_tokens": 8138.0,
      "step": 4739,
      "turn_loss": 0.19319696724414825,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 10698.0,
      "epoch": 0.22021929009477792,
      "grad_norm": 0.5323823690414429,
      "learning_rate": 6.711343136379537e-06,
      "loss": 0.15,
      "mae_dtheta": 0.029086213558912277,
      "mae_dx": 0.004066408146172762,
      "mae_dy": 0.002959762467071414,
      "pose_mae_dtheta": 0.2311985045671463,
      "pose_mae_dx": 0.04503967612981796,
      "pose_mae_dy": 0.05633561685681343,
      "pose_rmse_dtheta": 0.46555307507514954,
      "pose_rmse_dx": 0.11708542704582214,
      "pose_rmse_dy": 0.12758716940879822,
      "pose_rmse_mean": 0.23674190044403076,
      "rmse_dtheta": 0.04918859153985977,
      "rmse_dx": 0.0119625860825181,
      "rmse_dy": 0.005905007012188435,
      "rmse_mean": 0.022352062165737152,
      "rotation_flip": 0.01515151560306549,
      "sparse_tokens": 8822.0,
      "step": 4740,
      "turn_loss": 0.15343604981899261,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2202657498606207,
      "grad_norm": 0.6489178538322449,
      "learning_rate": 6.710100716628345e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.012096120975911617,
      "mae_dx": 0.0023630065843462944,
      "mae_dy": 0.002227775752544403,
      "pose_mae_dtheta": 0.09111756831407547,
      "pose_mae_dx": 0.027047917246818542,
      "pose_mae_dy": 0.02703661471605301,
      "pose_rmse_dtheta": 0.2424047887325287,
      "pose_rmse_dx": 0.07186799496412277,
      "pose_rmse_dy": 0.06455336511135101,
      "pose_rmse_mean": 0.12627539038658142,
      "rmse_dtheta": 0.029278259724378586,
      "rmse_dx": 0.006876255385577679,
      "rmse_dy": 0.0056830202229321,
      "rmse_mean": 0.013945845887064934,
      "rotation_flip": 0.0014880952658131719,
      "sparse_tokens": 32089.0,
      "step": 4741,
      "turn_loss": 0.09378665685653687,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 41538.0,
      "epoch": 0.22031220962646347,
      "grad_norm": 0.5802448987960815,
      "learning_rate": 6.708858177288892e-06,
      "loss": 0.1366,
      "mae_dtheta": 0.02980736456811428,
      "mae_dx": 0.013060703873634338,
      "mae_dy": 0.005009219981729984,
      "pose_mae_dtheta": 0.2259126454591751,
      "pose_mae_dx": 0.1078013926744461,
      "pose_mae_dy": 0.0636221393942833,
      "pose_rmse_dtheta": 0.3858448266983032,
      "pose_rmse_dx": 0.22261162102222443,
      "pose_rmse_dy": 0.15529343485832214,
      "pose_rmse_mean": 0.25458329916000366,
      "rmse_dtheta": 0.045067206025123596,
      "rmse_dx": 0.025054989382624626,
      "rmse_dy": 0.00957635696977377,
      "rmse_mean": 0.02656618505716324,
      "rotation_flip": 0.011000524275004864,
      "sparse_tokens": 30138.0,
      "step": 4742,
      "turn_loss": 0.2708631753921509,
      "turns": 128.0,
      "turns_per_sample": 128.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.22035866939230625,
      "grad_norm": 0.6024796962738037,
      "learning_rate": 6.70761551844807e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.03374640271067619,
      "mae_dx": 0.009712944738566875,
      "mae_dy": 0.0026759121101349592,
      "pose_mae_dtheta": 0.25171011686325073,
      "pose_mae_dx": 0.08020763844251633,
      "pose_mae_dy": 0.03626145422458649,
      "pose_rmse_dtheta": 0.4621492922306061,
      "pose_rmse_dx": 0.1996060162782669,
      "pose_rmse_dy": 0.10316700488328934,
      "pose_rmse_mean": 0.2549741268157959,
      "rmse_dtheta": 0.054724957793951035,
      "rmse_dx": 0.02214767411351204,
      "rmse_dy": 0.006013567093759775,
      "rmse_mean": 0.027628732845187187,
      "rotation_flip": 0.012987012974917889,
      "sparse_tokens": 11825.0,
      "step": 4743,
      "turn_loss": 0.23649999499320984,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.22040512915814905,
      "grad_norm": 0.6585063934326172,
      "learning_rate": 6.706372740192777e-06,
      "loss": 0.1522,
      "mae_dtheta": 0.02360939420759678,
      "mae_dx": 0.010096214711666107,
      "mae_dy": 0.0049861459992825985,
      "pose_mae_dtheta": 0.16823546588420868,
      "pose_mae_dx": 0.08069062232971191,
      "pose_mae_dy": 0.05392824858427048,
      "pose_rmse_dtheta": 0.3626280128955841,
      "pose_rmse_dx": 0.17850710451602936,
      "pose_rmse_dy": 0.14167475700378418,
      "pose_rmse_mean": 0.22760330140590668,
      "rmse_dtheta": 0.041866373270750046,
      "rmse_dx": 0.020634453743696213,
      "rmse_dy": 0.013239930383861065,
      "rmse_mean": 0.025246918201446533,
      "rotation_flip": 0.013245033100247383,
      "sparse_tokens": 13663.0,
      "step": 4744,
      "turn_loss": 0.20475038886070251,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 32015.0,
      "epoch": 0.22045158892399183,
      "grad_norm": 0.5794621109962463,
      "learning_rate": 6.705129842609923e-06,
      "loss": 0.1741,
      "mae_dtheta": 0.0303152184933424,
      "mae_dx": 0.01449637208133936,
      "mae_dy": 0.005773063749074936,
      "pose_mae_dtheta": 0.22902657091617584,
      "pose_mae_dx": 0.11429709941148758,
      "pose_mae_dy": 0.06791592389345169,
      "pose_rmse_dtheta": 0.42414870858192444,
      "pose_rmse_dx": 0.2550189197063446,
      "pose_rmse_dy": 0.15385520458221436,
      "pose_rmse_mean": 0.27767428755760193,
      "rmse_dtheta": 0.04713123291730881,
      "rmse_dx": 0.0283361729234457,
      "rmse_dy": 0.010945213958621025,
      "rmse_mean": 0.02880420908331871,
      "rotation_flip": 0.0118881119415164,
      "sparse_tokens": 25275.0,
      "step": 4745,
      "turn_loss": 0.2560536861419678,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.2204980486898346,
      "grad_norm": 0.591903567314148,
      "learning_rate": 6.703886825786423e-06,
      "loss": 0.1093,
      "mae_dtheta": 0.033057574182748795,
      "mae_dx": 0.010765215381979942,
      "mae_dy": 0.006109870038926601,
      "pose_mae_dtheta": 0.28260767459869385,
      "pose_mae_dx": 0.08895514160394669,
      "pose_mae_dy": 0.09463005512952805,
      "pose_rmse_dtheta": 0.5065451860427856,
      "pose_rmse_dx": 0.20230858027935028,
      "pose_rmse_dy": 0.20795409381389618,
      "pose_rmse_mean": 0.30560263991355896,
      "rmse_dtheta": 0.051120322197675705,
      "rmse_dx": 0.024119393900036812,
      "rmse_dy": 0.012060475535690784,
      "rmse_mean": 0.029100066050887108,
      "rotation_flip": 0.010703363455832005,
      "sparse_tokens": 12697.0,
      "step": 4746,
      "turn_loss": 0.24249224364757538,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22054450845567738,
      "grad_norm": 0.7657673954963684,
      "learning_rate": 6.702643689809205e-06,
      "loss": 0.121,
      "mae_dtheta": 0.011741592548787594,
      "mae_dx": 0.0024412130005657673,
      "mae_dy": 0.0032599102705717087,
      "pose_mae_dtheta": 0.0817299485206604,
      "pose_mae_dx": 0.02896767295897007,
      "pose_mae_dy": 0.03392201289534569,
      "pose_rmse_dtheta": 0.2390957772731781,
      "pose_rmse_dx": 0.07501360774040222,
      "pose_rmse_dy": 0.11511479318141937,
      "pose_rmse_mean": 0.14307473599910736,
      "rmse_dtheta": 0.026825180277228355,
      "rmse_dx": 0.006959906313568354,
      "rmse_dy": 0.009173995815217495,
      "rmse_mean": 0.014319694600999355,
      "rotation_flip": 0.0024135157000273466,
      "sparse_tokens": 32105.0,
      "step": 4747,
      "turn_loss": 0.10866359621286392,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.22059096822152016,
      "grad_norm": 0.6385875344276428,
      "learning_rate": 6.701400434765198e-06,
      "loss": 0.1741,
      "mae_dtheta": 0.013088255189359188,
      "mae_dx": 0.003132750978693366,
      "mae_dy": 0.002653812989592552,
      "pose_mae_dtheta": 0.08836111426353455,
      "pose_mae_dx": 0.033468060195446014,
      "pose_mae_dy": 0.02980457991361618,
      "pose_rmse_dtheta": 0.238872691988945,
      "pose_rmse_dx": 0.08825387805700302,
      "pose_rmse_dy": 0.06771060824394226,
      "pose_rmse_mean": 0.1316123902797699,
      "rmse_dtheta": 0.028831377625465393,
      "rmse_dx": 0.009488319046795368,
      "rmse_dy": 0.005787442438304424,
      "rmse_mean": 0.014702379703521729,
      "rotation_flip": 0.004091653041541576,
      "sparse_tokens": 32121.0,
      "step": 4748,
      "turn_loss": 0.11722900718450546,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.22063742798736294,
      "grad_norm": 0.34803318977355957,
      "learning_rate": 6.700157060741347e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.008369271643459797,
      "mae_dx": 0.003129824297502637,
      "mae_dy": 0.001869934261776507,
      "pose_mae_dtheta": 0.06313163787126541,
      "pose_mae_dx": 0.030413873493671417,
      "pose_mae_dy": 0.029519513249397278,
      "pose_rmse_dtheta": 0.16964057087898254,
      "pose_rmse_dx": 0.09672428667545319,
      "pose_rmse_dy": 0.08901933580636978,
      "pose_rmse_mean": 0.11846140027046204,
      "rmse_dtheta": 0.02020164206624031,
      "rmse_dx": 0.011463398113846779,
      "rmse_dy": 0.004772398620843887,
      "rmse_mean": 0.012145813554525375,
      "rotation_flip": 0.002270147670060396,
      "sparse_tokens": 32041.0,
      "step": 4749,
      "turn_loss": 0.08851508051156998,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22068388775320572,
      "grad_norm": 0.4470438063144684,
      "learning_rate": 6.6989135678245986e-06,
      "loss": 0.0773,
      "mae_dtheta": 0.010401972569525242,
      "mae_dx": 0.0015898876590654254,
      "mae_dy": 0.0024164309725165367,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44704392552375793,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 171.26158142089844,
      "model/head/act_norm_mean": 115.42935211489899,
      "model/head/act_norm_min": 69.97589111328125,
      "model/head/act_over_embed": 79.32413143997927,
      "model/head/grad_frac": 0.09520912170410156,
      "model/head/grad_norm": 0.042562659829854965,
      "model/head/grad_zero_frac": 0.00017703764024190605,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6989869397095959,
      "model/head/update_ratio": 0.0007295709219761193,
      "model/head/weight_delta": 8.10550308227539,
      "model/head/weight_delta_rel": 0.14219453930854797,
      "model/head/weight_norm": 58.33930587768555,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4192535877227783,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4191825764061624,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41911616921424866,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28806619095542585,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09540010243654251,
      "model/modality_embedder.encoders.pose/grad_norm": 0.042648036032915115,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5289903307174888,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013799953740090132,
      "model/modality_embedder.encoders.pose/weight_delta": 2.654003858566284,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08671458065509796,
      "model/modality_embedder.encoders.pose/weight_norm": 30.904478073120117,
      "model/modality_embedder/grad_frac": 0.09540010243654251,
      "model/modality_embedder/grad_norm": 0.042648036032915115,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5289903307174888,
      "model/modality_embedder/update_ratio": 0.0013799953740090132,
      "model/modality_embedder/weight_delta": 2.654003858566284,
      "model/modality_embedder/weight_delta_rel": 0.08671458065509796,
      "model/modality_embedder/weight_norm": 30.904478073120117,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.57061767578125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.105186287477956,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.941701889038086,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.565309693064464,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06877373158931732,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.030744878575205803,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001106112147681415,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.973196029663086,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07190445065498352,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.79544448852539,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.09066009521484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.137007475549144,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.308598518371582,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.274386873569142,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07819195091724396,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.034955237060785294,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011850420851260424,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.496689558029175,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08648727834224701,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.497041702270508,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.20806121826172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.031961479878145,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.46921157836914,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.576617006182932,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10957753658294678,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04898597300052643,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016086609102785587,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.685108184814453,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09016090631484985,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.451396942138672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.89529418945312,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.83692079525413,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.275144577026367,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.817001946004655,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.13188724219799042,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05895938724279404,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 8.574080129619688e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019824071787297726,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.2897956371307373,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0782543495297432,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.741310119628906,
      "model/normalizer/grad_frac": 0.48131245374679565,
      "model/normalizer/grad_norm": 0.2151678055524826,
      "model/normalizer/grad_zero_frac": 0.00012999122554901987,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0027462043799459934,
      "model/normalizer/weight_delta": 4.862738609313965,
      "model/normalizer/weight_delta_rel": 0.06262926012277603,
      "model/normalizer/weight_norm": 78.35098266601562,
      "pose_mae_dtheta": 0.06898006051778793,
      "pose_mae_dx": 0.021687453612685204,
      "pose_mae_dy": 0.02758401818573475,
      "pose_rmse_dtheta": 0.17980822920799255,
      "pose_rmse_dx": 0.052108265459537506,
      "pose_rmse_dy": 0.06386195123195648,
      "pose_rmse_mean": 0.09859281778335571,
      "rmse_dtheta": 0.024023596197366714,
      "rmse_dx": 0.0048205917701125145,
      "rmse_dy": 0.005402523558586836,
      "rmse_mean": 0.011415570974349976,
      "rotation_flip": 0.004798080772161484,
      "sparse_tokens": 32105.0,
      "step": 4750,
      "turn_loss": 0.08877083659172058,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2207303475190485,
      "grad_norm": 0.4648135304450989,
      "learning_rate": 6.697669956101914e-06,
      "loss": 0.1364,
      "mae_dtheta": 0.007045031990855932,
      "mae_dx": 0.001343271811492741,
      "mae_dy": 0.001450162846595049,
      "pose_mae_dtheta": 0.05021115764975548,
      "pose_mae_dx": 0.013133195228874683,
      "pose_mae_dy": 0.01747400499880314,
      "pose_rmse_dtheta": 0.15052483975887299,
      "pose_rmse_dx": 0.03385355696082115,
      "pose_rmse_dy": 0.04309890419244766,
      "pose_rmse_mean": 0.0758257731795311,
      "rmse_dtheta": 0.02031567320227623,
      "rmse_dx": 0.0044446298852562904,
      "rmse_dy": 0.0041308049112558365,
      "rmse_mean": 0.009630369022488594,
      "rotation_flip": 0.0053705694153904915,
      "sparse_tokens": 32089.0,
      "step": 4751,
      "turn_loss": 0.05729522183537483,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.2207768072848913,
      "grad_norm": 0.40103232860565186,
      "learning_rate": 6.696426225660256e-06,
      "loss": 0.1041,
      "mae_dtheta": 0.03785764425992966,
      "mae_dx": 0.01966240629553795,
      "mae_dy": 0.006020595785230398,
      "pose_mae_dtheta": 0.29257237911224365,
      "pose_mae_dx": 0.1617782562971115,
      "pose_mae_dy": 0.06785862147808075,
      "pose_rmse_dtheta": 0.5027498006820679,
      "pose_rmse_dx": 0.32736870646476746,
      "pose_rmse_dy": 0.1625654399394989,
      "pose_rmse_mean": 0.33089467883110046,
      "rmse_dtheta": 0.05591105669736862,
      "rmse_dx": 0.03419257327914238,
      "rmse_dy": 0.011880816891789436,
      "rmse_mean": 0.03399481624364853,
      "rotation_flip": 0.015004413202404976,
      "sparse_tokens": 18719.0,
      "step": 4752,
      "turn_loss": 0.2453601062297821,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 12999.0,
      "epoch": 0.22082326705073407,
      "grad_norm": 0.40623939037323,
      "learning_rate": 6.695182376586603e-06,
      "loss": 0.0887,
      "mae_dtheta": 0.025674426928162575,
      "mae_dx": 0.009805184789001942,
      "mae_dy": 0.0041062538512051105,
      "pose_mae_dtheta": 0.17317788302898407,
      "pose_mae_dx": 0.07127536088228226,
      "pose_mae_dy": 0.04643622413277626,
      "pose_rmse_dtheta": 0.38322827219963074,
      "pose_rmse_dx": 0.18256030976772308,
      "pose_rmse_dy": 0.09277176856994629,
      "pose_rmse_mean": 0.21952012181282043,
      "rmse_dtheta": 0.04377586767077446,
      "rmse_dx": 0.022562047466635704,
      "rmse_dy": 0.007229107432067394,
      "rmse_mean": 0.024522339925169945,
      "rotation_flip": 0.0056603774428367615,
      "sparse_tokens": 9873.0,
      "step": 4753,
      "turn_loss": 0.21526403725147247,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22086972681657685,
      "grad_norm": 0.5464630126953125,
      "learning_rate": 6.693938408967937e-06,
      "loss": 0.129,
      "mae_dtheta": 0.014863759279251099,
      "mae_dx": 0.0026327723171561956,
      "mae_dy": 0.004058793652802706,
      "pose_mae_dtheta": 0.09938075393438339,
      "pose_mae_dx": 0.03606876730918884,
      "pose_mae_dy": 0.0381537601351738,
      "pose_rmse_dtheta": 0.24201200902462006,
      "pose_rmse_dx": 0.09736646711826324,
      "pose_rmse_dy": 0.08912473917007446,
      "pose_rmse_mean": 0.14283441007137299,
      "rmse_dtheta": 0.029261086136102676,
      "rmse_dx": 0.007266161032021046,
      "rmse_dy": 0.008727001957595348,
      "rmse_mean": 0.015084750019013882,
      "rotation_flip": 0.003953990060836077,
      "sparse_tokens": 32073.0,
      "step": 4754,
      "turn_loss": 0.12655377388000488,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22091618658241963,
      "grad_norm": 0.43914273381233215,
      "learning_rate": 6.692694322891249e-06,
      "loss": 0.0793,
      "mae_dtheta": 0.011256136931478977,
      "mae_dx": 0.0019246978918090463,
      "mae_dy": 0.002515016822144389,
      "pose_mae_dtheta": 0.07823836803436279,
      "pose_mae_dx": 0.025143466889858246,
      "pose_mae_dy": 0.028095725923776627,
      "pose_rmse_dtheta": 0.21261267364025116,
      "pose_rmse_dx": 0.0699605867266655,
      "pose_rmse_dy": 0.0668695867061615,
      "pose_rmse_mean": 0.11648094654083252,
      "rmse_dtheta": 0.025688670575618744,
      "rmse_dx": 0.005428781732916832,
      "rmse_dy": 0.0057173119857907295,
      "rmse_mean": 0.012278255075216293,
      "rotation_flip": 0.002761341165751219,
      "sparse_tokens": 32105.0,
      "step": 4755,
      "turn_loss": 0.07946383953094482,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.2209626463482624,
      "grad_norm": 0.3794572055339813,
      "learning_rate": 6.691450118443538e-06,
      "loss": 0.0525,
      "mae_dtheta": 0.01988479308784008,
      "mae_dx": 0.007783279754221439,
      "mae_dy": 0.0025946134701371193,
      "pose_mae_dtheta": 0.16860298812389374,
      "pose_mae_dx": 0.05627838522195816,
      "pose_mae_dy": 0.050854749977588654,
      "pose_rmse_dtheta": 0.3599355220794678,
      "pose_rmse_dx": 0.14222164452075958,
      "pose_rmse_dy": 0.12872090935707092,
      "pose_rmse_mean": 0.21029269695281982,
      "rmse_dtheta": 0.04044318571686745,
      "rmse_dx": 0.01839273050427437,
      "rmse_dy": 0.0044172657653689384,
      "rmse_mean": 0.021084394305944443,
      "rotation_flip": 0.0,
      "sparse_tokens": 3320.0,
      "step": 4756,
      "turn_loss": 0.14812591671943665,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.22100910611410518,
      "grad_norm": 0.5685384273529053,
      "learning_rate": 6.690205795711812e-06,
      "loss": 0.1052,
      "mae_dtheta": 0.008507691323757172,
      "mae_dx": 0.0010103352833539248,
      "mae_dy": 0.0016416567377746105,
      "pose_mae_dtheta": 0.060097794979810715,
      "pose_mae_dx": 0.01438297051936388,
      "pose_mae_dy": 0.027662966400384903,
      "pose_rmse_dtheta": 0.16211330890655518,
      "pose_rmse_dx": 0.03900261968374252,
      "pose_rmse_dy": 0.08842521905899048,
      "pose_rmse_mean": 0.09651371836662292,
      "rmse_dtheta": 0.01937871426343918,
      "rmse_dx": 0.002813158091157675,
      "rmse_dy": 0.00377225736156106,
      "rmse_mean": 0.008654709905385971,
      "rotation_flip": 0.007912088185548782,
      "sparse_tokens": 32121.0,
      "step": 4757,
      "turn_loss": 0.07086091488599777,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22105556587994796,
      "grad_norm": 0.4537314474582672,
      "learning_rate": 6.688961354783088e-06,
      "loss": 0.1265,
      "mae_dtheta": 0.015434649772942066,
      "mae_dx": 0.004031103104352951,
      "mae_dy": 0.0045846207067370415,
      "pose_mae_dtheta": 0.1104380264878273,
      "pose_mae_dx": 0.04045785591006279,
      "pose_mae_dy": 0.03568216785788536,
      "pose_rmse_dtheta": 0.27942925691604614,
      "pose_rmse_dx": 0.1029587909579277,
      "pose_rmse_dy": 0.07323197275400162,
      "pose_rmse_mean": 0.15187335014343262,
      "rmse_dtheta": 0.033646803349256516,
      "rmse_dx": 0.011334129609167576,
      "rmse_dy": 0.010202876292169094,
      "rmse_mean": 0.018394604325294495,
      "rotation_flip": 0.008130080997943878,
      "sparse_tokens": 32073.0,
      "step": 4758,
      "turn_loss": 0.1561877578496933,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.22110202564579073,
      "grad_norm": 0.4069226086139679,
      "learning_rate": 6.68771679574439e-06,
      "loss": 0.0898,
      "mae_dtheta": 0.008296570740640163,
      "mae_dx": 0.0011593796079978347,
      "mae_dy": 0.0012068611104041338,
      "pose_mae_dtheta": 0.05604486167430878,
      "pose_mae_dx": 0.01369311660528183,
      "pose_mae_dy": 0.015851905569434166,
      "pose_rmse_dtheta": 0.18229468166828156,
      "pose_rmse_dx": 0.03478870168328285,
      "pose_rmse_dy": 0.038956619799137115,
      "pose_rmse_mean": 0.08534666895866394,
      "rmse_dtheta": 0.02145233005285263,
      "rmse_dx": 0.003436016384512186,
      "rmse_dy": 0.0028042474295943975,
      "rmse_mean": 0.00923086516559124,
      "rotation_flip": 0.002482416108250618,
      "sparse_tokens": 32137.0,
      "step": 4759,
      "turn_loss": 0.057496100664138794,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.22114848541163354,
      "grad_norm": 0.48311999440193176,
      "learning_rate": 6.686472118682749e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.015317379496991634,
      "mae_dx": 0.0021505667828023434,
      "mae_dy": 0.0036156359128654003,
      "pose_mae_dtheta": 0.10406061261892319,
      "pose_mae_dx": 0.033745359629392624,
      "pose_mae_dy": 0.04153125360608101,
      "pose_rmse_dtheta": 0.2576598525047302,
      "pose_rmse_dx": 0.08933025598526001,
      "pose_rmse_dy": 0.11360757797956467,
      "pose_rmse_mean": 0.15353256464004517,
      "rmse_dtheta": 0.03032308630645275,
      "rmse_dx": 0.005971670616418123,
      "rmse_dy": 0.007816316559910774,
      "rmse_mean": 0.014703691005706787,
      "rotation_flip": 0.00443232199177146,
      "sparse_tokens": 32089.0,
      "step": 4760,
      "turn_loss": 0.125226691365242,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.22119494517747632,
      "grad_norm": 0.4954293370246887,
      "learning_rate": 6.685227323685209e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.022420665249228477,
      "mae_dx": 0.008717061951756477,
      "mae_dy": 0.00479107117280364,
      "pose_mae_dtheta": 0.1672378033399582,
      "pose_mae_dx": 0.0650111511349678,
      "pose_mae_dy": 0.0762348622083664,
      "pose_rmse_dtheta": 0.26526638865470886,
      "pose_rmse_dx": 0.11928541958332062,
      "pose_rmse_dy": 0.15159186720848083,
      "pose_rmse_mean": 0.1787145584821701,
      "rmse_dtheta": 0.03521323576569557,
      "rmse_dx": 0.018122656270861626,
      "rmse_dy": 0.007908345200121403,
      "rmse_mean": 0.020414745435118675,
      "rotation_flip": 0.012232416309416294,
      "sparse_tokens": 5329.0,
      "step": 4761,
      "turn_loss": 0.31595295667648315,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.2212414049433191,
      "grad_norm": 0.6365616321563721,
      "learning_rate": 6.683982410838819e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.03582774102687836,
      "mae_dx": 0.016447657719254494,
      "mae_dy": 0.002782242139801383,
      "pose_mae_dtheta": 0.3143423795700073,
      "pose_mae_dx": 0.13240665197372437,
      "pose_mae_dy": 0.055099885910749435,
      "pose_rmse_dtheta": 0.5625582337379456,
      "pose_rmse_dx": 0.27833685278892517,
      "pose_rmse_dy": 0.12613190710544586,
      "pose_rmse_mean": 0.3223423361778259,
      "rmse_dtheta": 0.055919792503118515,
      "rmse_dx": 0.030479539185762405,
      "rmse_dy": 0.004678996279835701,
      "rmse_mean": 0.03035944327712059,
      "rotation_flip": 0.010695187374949455,
      "sparse_tokens": 12769.0,
      "step": 4762,
      "turn_loss": 0.22174720466136932,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.22128786470916187,
      "grad_norm": 0.5462067127227783,
      "learning_rate": 6.682737380230633e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.012645325623452663,
      "mae_dx": 0.003359640948474407,
      "mae_dy": 0.0028033703565597534,
      "pose_mae_dtheta": 0.08974683284759521,
      "pose_mae_dx": 0.03932125121355057,
      "pose_mae_dy": 0.03144243359565735,
      "pose_rmse_dtheta": 0.21827000379562378,
      "pose_rmse_dx": 0.0986388623714447,
      "pose_rmse_dy": 0.07662118226289749,
      "pose_rmse_mean": 0.1311766803264618,
      "rmse_dtheta": 0.028151126578450203,
      "rmse_dx": 0.009039106778800488,
      "rmse_dy": 0.006523301359266043,
      "rmse_mean": 0.014571177773177624,
      "rotation_flip": 0.004454343114048243,
      "sparse_tokens": 32089.0,
      "step": 4763,
      "turn_loss": 0.12175813317298889,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22133432447500465,
      "grad_norm": 0.49272143840789795,
      "learning_rate": 6.6814922319477195e-06,
      "loss": 0.118,
      "mae_dtheta": 0.009160643443465233,
      "mae_dx": 0.00196129665710032,
      "mae_dy": 0.002184844808652997,
      "pose_mae_dtheta": 0.0672587975859642,
      "pose_mae_dx": 0.02393820695579052,
      "pose_mae_dy": 0.026900216937065125,
      "pose_rmse_dtheta": 0.17222531139850616,
      "pose_rmse_dx": 0.08048108220100403,
      "pose_rmse_dy": 0.0743887722492218,
      "pose_rmse_mean": 0.10903172940015793,
      "rmse_dtheta": 0.022284885868430138,
      "rmse_dx": 0.0060434197075665,
      "rmse_dy": 0.006061204709112644,
      "rmse_mean": 0.011463170871138573,
      "rotation_flip": 0.0031432420946657658,
      "sparse_tokens": 32105.0,
      "step": 4764,
      "turn_loss": 0.07713501155376434,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.22138078424084742,
      "grad_norm": 0.3394099771976471,
      "learning_rate": 6.680246966077151e-06,
      "loss": 0.0803,
      "mae_dtheta": 0.009594726376235485,
      "mae_dx": 0.0016653650673106313,
      "mae_dy": 0.002191998064517975,
      "pose_mae_dtheta": 0.06594724208116531,
      "pose_mae_dx": 0.02095470018684864,
      "pose_mae_dy": 0.025126134976744652,
      "pose_rmse_dtheta": 0.1682111620903015,
      "pose_rmse_dx": 0.050370559096336365,
      "pose_rmse_dy": 0.05748055502772331,
      "pose_rmse_mean": 0.09202076494693756,
      "rmse_dtheta": 0.02161397412419319,
      "rmse_dx": 0.0048206462524831295,
      "rmse_dy": 0.004455043468624353,
      "rmse_mean": 0.010296555235981941,
      "rotation_flip": 0.0024991075042635202,
      "sparse_tokens": 32153.0,
      "step": 4765,
      "turn_loss": 0.07696087658405304,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2214272440066902,
      "grad_norm": 0.3819999694824219,
      "learning_rate": 6.67900158270601e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.007094373926520348,
      "mae_dx": 0.0013679086696356535,
      "mae_dy": 0.0009230112191289663,
      "pose_mae_dtheta": 0.05828848481178284,
      "pose_mae_dx": 0.013680638745427132,
      "pose_mae_dy": 0.015086820349097252,
      "pose_rmse_dtheta": 0.18948987126350403,
      "pose_rmse_dx": 0.0379643440246582,
      "pose_rmse_dy": 0.04092177376151085,
      "pose_rmse_mean": 0.08945866674184799,
      "rmse_dtheta": 0.0204110499471426,
      "rmse_dx": 0.004661487881094217,
      "rmse_dy": 0.0019980042707175016,
      "rmse_mean": 0.0090235136449337,
      "rotation_flip": 0.001816530479118228,
      "sparse_tokens": 32153.0,
      "step": 4766,
      "turn_loss": 0.0502965971827507,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.22147370377253298,
      "grad_norm": 0.3616882562637329,
      "learning_rate": 6.677756081921389e-06,
      "loss": 0.0675,
      "mae_dtheta": 0.007543585728853941,
      "mae_dx": 0.0019867282826453447,
      "mae_dy": 0.0020236261188983917,
      "pose_mae_dtheta": 0.04667740687727928,
      "pose_mae_dx": 0.02150539495050907,
      "pose_mae_dy": 0.02003639191389084,
      "pose_rmse_dtheta": 0.09250179678201675,
      "pose_rmse_dx": 0.053655803203582764,
      "pose_rmse_dy": 0.050456639379262924,
      "pose_rmse_mean": 0.06553807854652405,
      "rmse_dtheta": 0.016091568395495415,
      "rmse_dx": 0.0050142728723585606,
      "rmse_dy": 0.0048361592926084995,
      "rmse_mean": 0.008647333830595016,
      "rotation_flip": 0.002423822646960616,
      "sparse_tokens": 32249.0,
      "step": 4767,
      "turn_loss": 0.06893467903137207,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.22152016353837575,
      "grad_norm": 0.6674636006355286,
      "learning_rate": 6.676510463810384e-06,
      "loss": 0.1906,
      "mae_dtheta": 0.04354820400476456,
      "mae_dx": 0.010773174464702606,
      "mae_dy": 0.006880095694214106,
      "pose_mae_dtheta": 0.3238109052181244,
      "pose_mae_dx": 0.08819130808115005,
      "pose_mae_dy": 0.10020424425601959,
      "pose_rmse_dtheta": 0.5365127921104431,
      "pose_rmse_dx": 0.21392448246479034,
      "pose_rmse_dy": 0.2357456088066101,
      "pose_rmse_mean": 0.3287276327610016,
      "rmse_dtheta": 0.059479549527168274,
      "rmse_dx": 0.02279016003012657,
      "rmse_dy": 0.01364692859351635,
      "rmse_mean": 0.031972214579582214,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 7604.0,
      "step": 4768,
      "turn_loss": 0.30581751465797424,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22156662330421856,
      "grad_norm": 0.37839335203170776,
      "learning_rate": 6.675264728460103e-06,
      "loss": 0.0858,
      "mae_dtheta": 0.009657325223088264,
      "mae_dx": 0.0015020646387711167,
      "mae_dy": 0.002900743158534169,
      "pose_mae_dtheta": 0.06034567579627037,
      "pose_mae_dx": 0.025296220555901527,
      "pose_mae_dy": 0.03007211536169052,
      "pose_rmse_dtheta": 0.12213350832462311,
      "pose_rmse_dx": 0.06597743183374405,
      "pose_rmse_dy": 0.07565072178840637,
      "pose_rmse_mean": 0.08792056143283844,
      "rmse_dtheta": 0.0195772647857666,
      "rmse_dx": 0.0033733805175870657,
      "rmse_dy": 0.0063164010643959045,
      "rmse_mean": 0.009755682200193405,
      "rotation_flip": 0.006810897495597601,
      "sparse_tokens": 32105.0,
      "step": 4769,
      "turn_loss": 0.08422668278217316,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21101.0,
      "epoch": 0.22161308307006133,
      "grad_norm": 0.5715946555137634,
      "learning_rate": 6.67401887595766e-06,
      "loss": 0.1298,
      "mae_dtheta": 0.03932451829314232,
      "mae_dx": 0.012769505381584167,
      "mae_dy": 0.005276046227663755,
      "pose_mae_dtheta": 0.32567235827445984,
      "pose_mae_dx": 0.09554499387741089,
      "pose_mae_dy": 0.0590490885078907,
      "pose_rmse_dtheta": 0.5506331324577332,
      "pose_rmse_dx": 0.19222328066825867,
      "pose_rmse_dy": 0.1508137583732605,
      "pose_rmse_mean": 0.2978900671005249,
      "rmse_dtheta": 0.056674323976039886,
      "rmse_dx": 0.02464650571346283,
      "rmse_dy": 0.011433872394263744,
      "rmse_mean": 0.03091823309659958,
      "rotation_flip": 0.02369668334722519,
      "sparse_tokens": 15885.0,
      "step": 4770,
      "turn_loss": 0.34479695558547974,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 30400.0,
      "epoch": 0.2216595428359041,
      "grad_norm": 0.563759446144104,
      "learning_rate": 6.672772906390177e-06,
      "loss": 0.1833,
      "mae_dtheta": 0.028641220182180405,
      "mae_dx": 0.010935470461845398,
      "mae_dy": 0.004899380728602409,
      "pose_mae_dtheta": 0.2197677493095398,
      "pose_mae_dx": 0.09880856424570084,
      "pose_mae_dy": 0.0689249038696289,
      "pose_rmse_dtheta": 0.3986603021621704,
      "pose_rmse_dx": 0.21464750170707703,
      "pose_rmse_dy": 0.14637760818004608,
      "pose_rmse_mean": 0.25322848558425903,
      "rmse_dtheta": 0.04533771425485611,
      "rmse_dx": 0.023559048771858215,
      "rmse_dy": 0.00901426188647747,
      "rmse_mean": 0.025970343500375748,
      "rotation_flip": 0.014622258022427559,
      "sparse_tokens": 24769.0,
      "step": 4771,
      "turn_loss": 0.2675990164279938,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.2217060026017469,
      "grad_norm": 0.33895230293273926,
      "learning_rate": 6.671526819844788e-06,
      "loss": 0.0821,
      "mae_dtheta": 0.04276552051305771,
      "mae_dx": 0.006636250764131546,
      "mae_dy": 0.00520871439948678,
      "pose_mae_dtheta": 0.38749438524246216,
      "pose_mae_dx": 0.052169252187013626,
      "pose_mae_dy": 0.06575875729322433,
      "pose_rmse_dtheta": 0.6300501823425293,
      "pose_rmse_dx": 0.13335172832012177,
      "pose_rmse_dy": 0.15412844717502594,
      "pose_rmse_mean": 0.3058434724807739,
      "rmse_dtheta": 0.06176210939884186,
      "rmse_dx": 0.015779145061969757,
      "rmse_dy": 0.010027749463915825,
      "rmse_mean": 0.029189668595790863,
      "rotation_flip": 0.007692307699471712,
      "sparse_tokens": 6742.0,
      "step": 4772,
      "turn_loss": 0.2805790603160858,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.22175246236758966,
      "grad_norm": 0.349954754114151,
      "learning_rate": 6.670280616408632e-06,
      "loss": 0.0816,
      "mae_dtheta": 0.006849157158285379,
      "mae_dx": 0.0015046587213873863,
      "mae_dy": 0.0008916672668419778,
      "pose_mae_dtheta": 0.052396293729543686,
      "pose_mae_dx": 0.014557461254298687,
      "pose_mae_dy": 0.015018409118056297,
      "pose_rmse_dtheta": 0.1593446135520935,
      "pose_rmse_dx": 0.04198290407657623,
      "pose_rmse_dy": 0.03777789697051048,
      "pose_rmse_mean": 0.07970181107521057,
      "rmse_dtheta": 0.01976100169122219,
      "rmse_dx": 0.004699036478996277,
      "rmse_dy": 0.0019183933036401868,
      "rmse_mean": 0.008792811073362827,
      "rotation_flip": 0.0021008404437452555,
      "sparse_tokens": 32153.0,
      "step": 4773,
      "turn_loss": 0.05457494407892227,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.22179892213343244,
      "grad_norm": 0.6171848177909851,
      "learning_rate": 6.669034296168855e-06,
      "loss": 0.1373,
      "mae_dtheta": 0.007514135912060738,
      "mae_dx": 0.0016320770373567939,
      "mae_dy": 0.0015678167110309005,
      "pose_mae_dtheta": 0.05252203717827797,
      "pose_mae_dx": 0.01621384173631668,
      "pose_mae_dy": 0.024446962401270866,
      "pose_rmse_dtheta": 0.1304713934659958,
      "pose_rmse_dx": 0.06485109776258469,
      "pose_rmse_dy": 0.06873605400323868,
      "pose_rmse_mean": 0.08801951259374619,
      "rmse_dtheta": 0.01781168393790722,
      "rmse_dx": 0.006955434568226337,
      "rmse_dy": 0.004198246635496616,
      "rmse_mean": 0.009655121713876724,
      "rotation_flip": 0.008873719722032547,
      "sparse_tokens": 32025.0,
      "step": 4774,
      "turn_loss": 0.0615156814455986,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.22184538189927522,
      "grad_norm": 0.7029991149902344,
      "learning_rate": 6.667787859212615e-06,
      "loss": 0.2148,
      "mae_dtheta": 0.039436835795640945,
      "mae_dx": 0.010725099593400955,
      "mae_dy": 0.006449843756854534,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7029988765716553,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.44757080078125,
      "model/head/act_norm_mean": 102.59015143407534,
      "model/head/act_norm_min": 69.45855712890625,
      "model/head/act_over_embed": 70.50091252962666,
      "model/head/grad_frac": 0.10718884319067001,
      "model/head/grad_norm": 0.07535363733768463,
      "model/head/grad_zero_frac": 0.00018274853937327862,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6808781035958904,
      "model/head/update_ratio": 0.0012915534898638725,
      "model/head/weight_delta": 8.124383926391602,
      "model/head/weight_delta_rel": 0.14252576231956482,
      "model/head/weight_norm": 58.343414306640625,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41937941312789917,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4193222973797772,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4192686676979065,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2881622085165823,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07015706598758698,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04932033643126488,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5432326858108109,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015958123840391636,
      "model/modality_embedder.encoders.pose/weight_delta": 2.6623728275299072,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08698801696300507,
      "model/modality_embedder.encoders.pose/weight_norm": 30.906099319458008,
      "model/modality_embedder/grad_frac": 0.07015706598758698,
      "model/modality_embedder/grad_norm": 0.04932033643126488,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5432326858108109,
      "model/modality_embedder/update_ratio": 0.0015958123840391636,
      "model/modality_embedder/weight_delta": 2.6623728275299072,
      "model/modality_embedder/weight_delta_rel": 0.08698801696300507,
      "model/modality_embedder/weight_norm": 30.906099319458008,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.53530883789062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.999675540878453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.20719051361084,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.805592358046608,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08884821832180023,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06246019899845123,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0022470145486295223,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.9795571565628052,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07213626056909561,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.79697036743164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.1722412109375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.88803612198304,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.73951244354248,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.416082066344476,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0880419909954071,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06189341843128204,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0020981032866984606,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.505618095397949,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08679656684398651,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.49970054626465,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.84657287597656,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.59165715372907,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.156848907470703,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.58682638891174,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09257879108190536,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06508278846740723,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0021370670292526484,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.6947083473205566,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09048326313495636,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.45425796508789,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.68208312988281,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.515409260165253,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.981781005859375,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.90884684690566,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08911734074354172,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06264939159154892,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002106387633830309,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.297729015350342,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07852547615766525,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.74257469177246,
      "model/normalizer/grad_frac": 0.3609923720359802,
      "model/normalizer/grad_norm": 0.25377723574638367,
      "model/normalizer/grad_zero_frac": 0.00020089553436264396,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003238871693611145,
      "model/normalizer/weight_delta": 4.879674434661865,
      "model/normalizer/weight_delta_rel": 0.06284738332033157,
      "model/normalizer/weight_norm": 78.35359191894531,
      "pose_mae_dtheta": 0.3277639150619507,
      "pose_mae_dx": 0.07428094744682312,
      "pose_mae_dy": 0.06018098443746567,
      "pose_rmse_dtheta": 0.5409370064735413,
      "pose_rmse_dx": 0.16738352179527283,
      "pose_rmse_dy": 0.18043288588523865,
      "pose_rmse_mean": 0.2962511479854584,
      "rmse_dtheta": 0.05917451158165932,
      "rmse_dx": 0.022853728383779526,
      "rmse_dy": 0.01723497360944748,
      "rmse_mean": 0.03308773785829544,
      "rotation_flip": 0.014863749034702778,
      "sparse_tokens": 18712.0,
      "step": 4775,
      "turn_loss": 0.34573501348495483,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.221891841665118,
      "grad_norm": 0.8182211518287659,
      "learning_rate": 6.666541305627074e-06,
      "loss": 0.1661,
      "mae_dtheta": 0.02692200057208538,
      "mae_dx": 0.016823619604110718,
      "mae_dy": 0.005027392413467169,
      "pose_mae_dtheta": 0.19077108800411224,
      "pose_mae_dx": 0.14454469084739685,
      "pose_mae_dy": 0.05712303891777992,
      "pose_rmse_dtheta": 0.35937148332595825,
      "pose_rmse_dx": 0.3238871097564697,
      "pose_rmse_dy": 0.10250988602638245,
      "pose_rmse_mean": 0.26192283630371094,
      "rmse_dtheta": 0.04072915390133858,
      "rmse_dx": 0.03061487525701523,
      "rmse_dy": 0.006824641954153776,
      "rmse_mean": 0.02605622634291649,
      "rotation_flip": 0.006172839552164078,
      "sparse_tokens": 2517.0,
      "step": 4776,
      "turn_loss": 0.24946171045303345,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.2219383014309608,
      "grad_norm": 0.7807345986366272,
      "learning_rate": 6.665294635499404e-06,
      "loss": 0.2308,
      "mae_dtheta": 0.035066843032836914,
      "mae_dx": 0.008592354133725166,
      "mae_dy": 0.004502336494624615,
      "pose_mae_dtheta": 0.26928842067718506,
      "pose_mae_dx": 0.07731582224369049,
      "pose_mae_dy": 0.03859763592481613,
      "pose_rmse_dtheta": 0.49318066239356995,
      "pose_rmse_dx": 0.20402422547340393,
      "pose_rmse_dy": 0.1067165806889534,
      "pose_rmse_mean": 0.2679738402366638,
      "rmse_dtheta": 0.05603276193141937,
      "rmse_dx": 0.01944481022655964,
      "rmse_dy": 0.013071438297629356,
      "rmse_mean": 0.02951633743941784,
      "rotation_flip": 0.020576132461428642,
      "sparse_tokens": 12301.0,
      "step": 4777,
      "turn_loss": 0.2573332190513611,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.22198476119680358,
      "grad_norm": 0.5426123738288879,
      "learning_rate": 6.664047848916788e-06,
      "loss": 0.0858,
      "mae_dtheta": 0.01661161333322525,
      "mae_dx": 0.010882199741899967,
      "mae_dy": 0.004265947733074427,
      "pose_mae_dtheta": 0.0956965982913971,
      "pose_mae_dx": 0.07147970795631409,
      "pose_mae_dy": 0.06505583226680756,
      "pose_rmse_dtheta": 0.141903817653656,
      "pose_rmse_dx": 0.14666631817817688,
      "pose_rmse_dy": 0.17522132396697998,
      "pose_rmse_mean": 0.15459716320037842,
      "rmse_dtheta": 0.02717207744717598,
      "rmse_dx": 0.02301124855875969,
      "rmse_dy": 0.008144062012434006,
      "rmse_mean": 0.019442463293671608,
      "rotation_flip": 0.016483517363667488,
      "sparse_tokens": 3320.0,
      "step": 4778,
      "turn_loss": 0.19501984119415283,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.22203122096264635,
      "grad_norm": 0.7733378410339355,
      "learning_rate": 6.662800945966412e-06,
      "loss": 0.1111,
      "mae_dtheta": 0.03315415233373642,
      "mae_dx": 0.016365226358175278,
      "mae_dy": 0.0027222936041653156,
      "pose_mae_dtheta": 0.27917733788490295,
      "pose_mae_dx": 0.1499951183795929,
      "pose_mae_dy": 0.04320710897445679,
      "pose_rmse_dtheta": 0.4420407712459564,
      "pose_rmse_dx": 0.3145749270915985,
      "pose_rmse_dy": 0.08926623314619064,
      "pose_rmse_mean": 0.281960666179657,
      "rmse_dtheta": 0.049591563642024994,
      "rmse_dx": 0.030738679692149162,
      "rmse_dy": 0.005062919110059738,
      "rmse_mean": 0.028464388102293015,
      "rotation_flip": 0.008368200622498989,
      "sparse_tokens": 4164.0,
      "step": 4779,
      "turn_loss": 0.190159410238266,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.22207768072848913,
      "grad_norm": 0.7398819327354431,
      "learning_rate": 6.6615539267354735e-06,
      "loss": 0.1113,
      "mae_dtheta": 0.009739215485751629,
      "mae_dx": 0.001917030313052237,
      "mae_dy": 0.0015067057684063911,
      "pose_mae_dtheta": 0.07605563849210739,
      "pose_mae_dx": 0.022689562290906906,
      "pose_mae_dy": 0.02683468721807003,
      "pose_rmse_dtheta": 0.19203977286815643,
      "pose_rmse_dx": 0.0666135847568512,
      "pose_rmse_dy": 0.07172178477048874,
      "pose_rmse_mean": 0.11012504994869232,
      "rmse_dtheta": 0.022713810205459595,
      "rmse_dx": 0.0069076609797775745,
      "rmse_dy": 0.0034092168789356947,
      "rmse_mean": 0.011010229587554932,
      "rotation_flip": 0.0011273956624791026,
      "sparse_tokens": 32057.0,
      "step": 4780,
      "turn_loss": 0.07072915136814117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.2221241404943319,
      "grad_norm": 0.669343113899231,
      "learning_rate": 6.660306791311177e-06,
      "loss": 0.1687,
      "mae_dtheta": 0.022981636226177216,
      "mae_dx": 0.002972615184262395,
      "mae_dy": 0.003227869514375925,
      "pose_mae_dtheta": 0.22687628865242004,
      "pose_mae_dx": 0.02800746262073517,
      "pose_mae_dy": 0.04884510114789009,
      "pose_rmse_dtheta": 0.5106009244918823,
      "pose_rmse_dx": 0.054966580122709274,
      "pose_rmse_dy": 0.103053979575634,
      "pose_rmse_mean": 0.22287383675575256,
      "rmse_dtheta": 0.04464149475097656,
      "rmse_dx": 0.007895763032138348,
      "rmse_dy": 0.005735794547945261,
      "rmse_mean": 0.019424352794885635,
      "rotation_flip": 0.0058139534667134285,
      "sparse_tokens": 3384.0,
      "step": 4781,
      "turn_loss": 0.1390504688024521,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.22217060026017468,
      "grad_norm": 0.6489247679710388,
      "learning_rate": 6.659059539780737e-06,
      "loss": 0.151,
      "mae_dtheta": 0.037574056535959244,
      "mae_dx": 0.007328979205340147,
      "mae_dy": 0.005129317287355661,
      "pose_mae_dtheta": 0.29640525579452515,
      "pose_mae_dx": 0.06180696561932564,
      "pose_mae_dy": 0.06826470047235489,
      "pose_rmse_dtheta": 0.5166003108024597,
      "pose_rmse_dx": 0.13577130436897278,
      "pose_rmse_dy": 0.17083974182605743,
      "pose_rmse_mean": 0.27440381050109863,
      "rmse_dtheta": 0.05779232829809189,
      "rmse_dx": 0.017209583893418312,
      "rmse_dy": 0.011754759587347507,
      "rmse_mean": 0.02891889028251171,
      "rotation_flip": 0.021943572908639908,
      "sparse_tokens": 11752.0,
      "step": 4782,
      "turn_loss": 0.18401223421096802,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.22221706002601746,
      "grad_norm": 0.5119113326072693,
      "learning_rate": 6.65781217223137e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.019864296540617943,
      "mae_dx": 0.003205615095794201,
      "mae_dy": 0.0032533961348235607,
      "pose_mae_dtheta": 0.14049449563026428,
      "pose_mae_dx": 0.028215762227773666,
      "pose_mae_dy": 0.03630773350596428,
      "pose_rmse_dtheta": 0.34446316957473755,
      "pose_rmse_dx": 0.08015808463096619,
      "pose_rmse_dy": 0.08284927159547806,
      "pose_rmse_mean": 0.16915684938430786,
      "rmse_dtheta": 0.04001486301422119,
      "rmse_dx": 0.010041403584182262,
      "rmse_dy": 0.007573379669338465,
      "rmse_mean": 0.019209884107112885,
      "rotation_flip": 0.01320754736661911,
      "sparse_tokens": 10082.0,
      "step": 4783,
      "turn_loss": 0.1341826468706131,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.22226351979186024,
      "grad_norm": 0.6870467066764832,
      "learning_rate": 6.656564688750309e-06,
      "loss": 0.1593,
      "mae_dtheta": 0.011675173416733742,
      "mae_dx": 0.002362312050536275,
      "mae_dy": 0.0040327622555196285,
      "pose_mae_dtheta": 0.08019229769706726,
      "pose_mae_dx": 0.040125224739313126,
      "pose_mae_dy": 0.04138682037591934,
      "pose_rmse_dtheta": 0.177137553691864,
      "pose_rmse_dx": 0.11389114707708359,
      "pose_rmse_dy": 0.09690156579017639,
      "pose_rmse_mean": 0.12931010127067566,
      "rmse_dtheta": 0.023507315665483475,
      "rmse_dx": 0.0065169609151780605,
      "rmse_dy": 0.008996361866593361,
      "rmse_mean": 0.013006879948079586,
      "rotation_flip": 0.006009615492075682,
      "sparse_tokens": 32057.0,
      "step": 4784,
      "turn_loss": 0.10770885646343231,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.22230997955770304,
      "grad_norm": 0.4058873653411865,
      "learning_rate": 6.655317089424791e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.007766118273139,
      "mae_dx": 0.0013665494043380022,
      "mae_dy": 0.0017676762072369456,
      "pose_mae_dtheta": 0.04984348267316818,
      "pose_mae_dx": 0.016371581703424454,
      "pose_mae_dy": 0.023076331242918968,
      "pose_rmse_dtheta": 0.11289990693330765,
      "pose_rmse_dx": 0.045803241431713104,
      "pose_rmse_dy": 0.05407775193452835,
      "pose_rmse_mean": 0.0709269642829895,
      "rmse_dtheta": 0.016379687935113907,
      "rmse_dx": 0.004276268649846315,
      "rmse_dy": 0.003626774763688445,
      "rmse_mean": 0.008094243705272675,
      "rotation_flip": 0.0016326530603691936,
      "sparse_tokens": 32089.0,
      "step": 4785,
      "turn_loss": 0.0651678815484047,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.22235643932354582,
      "grad_norm": 0.8507251739501953,
      "learning_rate": 6.65406937434206e-06,
      "loss": 0.1731,
      "mae_dtheta": 0.028201745823025703,
      "mae_dx": 0.009065006859600544,
      "mae_dy": 0.0031670499593019485,
      "pose_mae_dtheta": 0.21521253883838654,
      "pose_mae_dx": 0.07815032452344894,
      "pose_mae_dy": 0.04389408230781555,
      "pose_rmse_dtheta": 0.4835506081581116,
      "pose_rmse_dx": 0.2202545553445816,
      "pose_rmse_dy": 0.1261906623840332,
      "pose_rmse_mean": 0.27666527032852173,
      "rmse_dtheta": 0.05155991390347481,
      "rmse_dx": 0.022077346220612526,
      "rmse_dy": 0.007738254498690367,
      "rmse_mean": 0.027125172317028046,
      "rotation_flip": 0.01690140925347805,
      "sparse_tokens": 7754.0,
      "step": 4786,
      "turn_loss": 0.21796652674674988,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.2224028990893886,
      "grad_norm": 1.0956835746765137,
      "learning_rate": 6.652821543589371e-06,
      "loss": 0.282,
      "mae_dtheta": 0.05214475840330124,
      "mae_dx": 0.013644647784531116,
      "mae_dy": 0.0067381183616817,
      "pose_mae_dtheta": 0.4480343759059906,
      "pose_mae_dx": 0.11181683093309402,
      "pose_mae_dy": 0.05721929669380188,
      "pose_rmse_dtheta": 0.6993521451950073,
      "pose_rmse_dx": 0.20892462134361267,
      "pose_rmse_dy": 0.11382926255464554,
      "pose_rmse_mean": 0.34070202708244324,
      "rmse_dtheta": 0.0700545683503151,
      "rmse_dx": 0.023819301277399063,
      "rmse_dy": 0.01457483135163784,
      "rmse_mean": 0.03614956885576248,
      "rotation_flip": 0.02773246355354786,
      "sparse_tokens": 9692.0,
      "step": 4787,
      "turn_loss": 0.4138447642326355,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22244935885523137,
      "grad_norm": 0.5808646082878113,
      "learning_rate": 6.651573597253983e-06,
      "loss": 0.113,
      "mae_dtheta": 0.008919263258576393,
      "mae_dx": 0.0017620372818782926,
      "mae_dy": 0.0021694519091397524,
      "pose_mae_dtheta": 0.06239936500787735,
      "pose_mae_dx": 0.022838851436972618,
      "pose_mae_dy": 0.024293242022395134,
      "pose_rmse_dtheta": 0.19484461843967438,
      "pose_rmse_dx": 0.06099219620227814,
      "pose_rmse_dy": 0.05740178003907204,
      "pose_rmse_mean": 0.10441286861896515,
      "rmse_dtheta": 0.021289141848683357,
      "rmse_dx": 0.005119072739034891,
      "rmse_dy": 0.004750712309032679,
      "rmse_mean": 0.010386308655142784,
      "rotation_flip": 0.003301692195236683,
      "sparse_tokens": 32105.0,
      "step": 4788,
      "turn_loss": 0.07997695356607437,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22249581862107415,
      "grad_norm": 0.3929525911808014,
      "learning_rate": 6.650325535423166e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.010564502328634262,
      "mae_dx": 0.0012726584682241082,
      "mae_dy": 0.0018343805568292737,
      "pose_mae_dtheta": 0.07510612159967422,
      "pose_mae_dx": 0.018177643418312073,
      "pose_mae_dy": 0.027102870866656303,
      "pose_rmse_dtheta": 0.2167537361383438,
      "pose_rmse_dx": 0.06241150572896004,
      "pose_rmse_dy": 0.07541882991790771,
      "pose_rmse_mean": 0.11819469183683395,
      "rmse_dtheta": 0.025861289352178574,
      "rmse_dx": 0.004088913090527058,
      "rmse_dy": 0.004948022309690714,
      "rmse_mean": 0.01163274236023426,
      "rotation_flip": 0.0010416667209938169,
      "sparse_tokens": 32073.0,
      "step": 4789,
      "turn_loss": 0.06569408625364304,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.22254227838691693,
      "grad_norm": 0.6562653183937073,
      "learning_rate": 6.6490773581842e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.020980389788746834,
      "mae_dx": 0.007946918718516827,
      "mae_dy": 0.004068671725690365,
      "pose_mae_dtheta": 0.1338552087545395,
      "pose_mae_dx": 0.083326555788517,
      "pose_mae_dy": 0.05966707691550255,
      "pose_rmse_dtheta": 0.24631132185459137,
      "pose_rmse_dx": 0.2280731201171875,
      "pose_rmse_dy": 0.12434930354356766,
      "pose_rmse_mean": 0.1995779126882553,
      "rmse_dtheta": 0.03546915948390961,
      "rmse_dx": 0.0207784753292799,
      "rmse_dy": 0.008037778548896313,
      "rmse_mean": 0.02142847143113613,
      "rotation_flip": 0.009999999776482582,
      "sparse_tokens": 10868.0,
      "step": 4790,
      "turn_loss": 0.21883656084537506,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2225887381527597,
      "grad_norm": 0.5471532344818115,
      "learning_rate": 6.647829065624368e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.012721720151603222,
      "mae_dx": 0.0019063132349401712,
      "mae_dy": 0.0035559728275984526,
      "pose_mae_dtheta": 0.08307642489671707,
      "pose_mae_dx": 0.02776714414358139,
      "pose_mae_dy": 0.032884616404771805,
      "pose_rmse_dtheta": 0.20806069672107697,
      "pose_rmse_dx": 0.06689508259296417,
      "pose_rmse_dy": 0.07381130009889603,
      "pose_rmse_mean": 0.11625569313764572,
      "rmse_dtheta": 0.026745611801743507,
      "rmse_dx": 0.004754323046654463,
      "rmse_dy": 0.007114145439118147,
      "rmse_mean": 0.012871360406279564,
      "rotation_flip": 0.006095374468713999,
      "sparse_tokens": 32105.0,
      "step": 4791,
      "turn_loss": 0.1013779491186142,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22263519791860248,
      "grad_norm": 0.4196043312549591,
      "learning_rate": 6.646580657830967e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.010255290195345879,
      "mae_dx": 0.002348070964217186,
      "mae_dy": 0.0028567248955368996,
      "pose_mae_dtheta": 0.07173693180084229,
      "pose_mae_dx": 0.02319919690489769,
      "pose_mae_dy": 0.028774114325642586,
      "pose_rmse_dtheta": 0.18211066722869873,
      "pose_rmse_dx": 0.06355695426464081,
      "pose_rmse_dy": 0.06358487159013748,
      "pose_rmse_mean": 0.10308416932821274,
      "rmse_dtheta": 0.022801442071795464,
      "rmse_dx": 0.008790339343249798,
      "rmse_dy": 0.007711165118962526,
      "rmse_mean": 0.013100981712341309,
      "rotation_flip": 0.00560828298330307,
      "sparse_tokens": 32073.0,
      "step": 4792,
      "turn_loss": 0.08828989416360855,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22268165768444528,
      "grad_norm": 0.5563891530036926,
      "learning_rate": 6.645332134891296e-06,
      "loss": 0.0936,
      "mae_dtheta": 0.011962377466261387,
      "mae_dx": 0.002429981715977192,
      "mae_dy": 0.0024613479617983103,
      "pose_mae_dtheta": 0.08327114582061768,
      "pose_mae_dx": 0.02771528623998165,
      "pose_mae_dy": 0.02437494695186615,
      "pose_rmse_dtheta": 0.22249667346477509,
      "pose_rmse_dx": 0.069718137383461,
      "pose_rmse_dy": 0.05357895791530609,
      "pose_rmse_mean": 0.11526459455490112,
      "rmse_dtheta": 0.026875106617808342,
      "rmse_dx": 0.007280012127012014,
      "rmse_dy": 0.006065240129828453,
      "rmse_mean": 0.013406786136329174,
      "rotation_flip": 0.003433476435020566,
      "sparse_tokens": 32105.0,
      "step": 4793,
      "turn_loss": 0.09897267073392868,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.22272811745028806,
      "grad_norm": 0.8569460511207581,
      "learning_rate": 6.644083496892665e-06,
      "loss": 0.1814,
      "mae_dtheta": 0.03756234794855118,
      "mae_dx": 0.01074243150651455,
      "mae_dy": 0.005855363328009844,
      "pose_mae_dtheta": 0.2908840775489807,
      "pose_mae_dx": 0.07115492969751358,
      "pose_mae_dy": 0.052246034145355225,
      "pose_rmse_dtheta": 0.5553656816482544,
      "pose_rmse_dx": 0.15407134592533112,
      "pose_rmse_dy": 0.15472431480884552,
      "pose_rmse_mean": 0.2880537807941437,
      "rmse_dtheta": 0.060491759330034256,
      "rmse_dx": 0.021646704524755478,
      "rmse_dy": 0.013849887996912003,
      "rmse_mean": 0.031996116042137146,
      "rotation_flip": 0.010380622930824757,
      "sparse_tokens": 9264.0,
      "step": 4794,
      "turn_loss": 0.26644638180732727,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22277457721613084,
      "grad_norm": 0.7036681175231934,
      "learning_rate": 6.642834743922393e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.008435460738837719,
      "mae_dx": 0.0014729828108102083,
      "mae_dy": 0.0016075351741164923,
      "pose_mae_dtheta": 0.058932773768901825,
      "pose_mae_dx": 0.015471236780285835,
      "pose_mae_dy": 0.021695613861083984,
      "pose_rmse_dtheta": 0.1802460104227066,
      "pose_rmse_dx": 0.04122648015618324,
      "pose_rmse_dy": 0.06410448253154755,
      "pose_rmse_mean": 0.0951923280954361,
      "rmse_dtheta": 0.022169701755046844,
      "rmse_dx": 0.004660939332097769,
      "rmse_dy": 0.004360306076705456,
      "rmse_mean": 0.010396982543170452,
      "rotation_flip": 0.0021822149865329266,
      "sparse_tokens": 32073.0,
      "step": 4795,
      "turn_loss": 0.06217780336737633,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2228210369819736,
      "grad_norm": 0.41003894805908203,
      "learning_rate": 6.641585876067807e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.008343460969626904,
      "mae_dx": 0.0021809192840009928,
      "mae_dy": 0.0017782292561605573,
      "pose_mae_dtheta": 0.06195728853344917,
      "pose_mae_dx": 0.02098672278225422,
      "pose_mae_dy": 0.022368641570210457,
      "pose_rmse_dtheta": 0.14730696380138397,
      "pose_rmse_dx": 0.04913420230150223,
      "pose_rmse_dy": 0.05630074441432953,
      "pose_rmse_mean": 0.08424731343984604,
      "rmse_dtheta": 0.018947659060359,
      "rmse_dx": 0.006064141169190407,
      "rmse_dy": 0.003907127305865288,
      "rmse_mean": 0.009639643132686615,
      "rotation_flip": 0.003859348129481077,
      "sparse_tokens": 32169.0,
      "step": 4796,
      "turn_loss": 0.07797424495220184,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.2228674967478164,
      "grad_norm": 0.4578193426132202,
      "learning_rate": 6.640336893416237e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.03983171656727791,
      "mae_dx": 0.015034391544759274,
      "mae_dy": 0.005304710473865271,
      "pose_mae_dtheta": 0.33281171321868896,
      "pose_mae_dx": 0.10100570321083069,
      "pose_mae_dy": 0.07663407176733017,
      "pose_rmse_dtheta": 0.5817235112190247,
      "pose_rmse_dx": 0.2283838838338852,
      "pose_rmse_dy": 0.1899607628583908,
      "pose_rmse_mean": 0.3333560824394226,
      "rmse_dtheta": 0.05685000494122505,
      "rmse_dx": 0.028749601915478706,
      "rmse_dy": 0.009949400089681149,
      "rmse_mean": 0.03184967115521431,
      "rotation_flip": 0.006896551698446274,
      "sparse_tokens": 10716.0,
      "step": 4797,
      "turn_loss": 0.31011444330215454,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 32663.0,
      "epoch": 0.22291395651365917,
      "grad_norm": 0.9018718004226685,
      "learning_rate": 6.639087796055029e-06,
      "loss": 0.1738,
      "mae_dtheta": 0.02921098843216896,
      "mae_dx": 0.0168035589158535,
      "mae_dy": 0.003507408546283841,
      "pose_mae_dtheta": 0.24667127430438995,
      "pose_mae_dx": 0.142588272690773,
      "pose_mae_dy": 0.05345681309700012,
      "pose_rmse_dtheta": 0.4580143988132477,
      "pose_rmse_dx": 0.3179331421852112,
      "pose_rmse_dy": 0.14161184430122375,
      "pose_rmse_mean": 0.30585312843322754,
      "rmse_dtheta": 0.04742659628391266,
      "rmse_dx": 0.03197138383984566,
      "rmse_dy": 0.007662929128855467,
      "rmse_mean": 0.02902030199766159,
      "rotation_flip": 0.0073461891151964664,
      "sparse_tokens": 24227.0,
      "step": 4798,
      "turn_loss": 0.23257306218147278,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 29522.0,
      "epoch": 0.22296041627950194,
      "grad_norm": 0.6412888765335083,
      "learning_rate": 6.637838584071532e-06,
      "loss": 0.2202,
      "mae_dtheta": 0.03851298615336418,
      "mae_dx": 0.012077011168003082,
      "mae_dy": 0.006149152293801308,
      "pose_mae_dtheta": 0.31752848625183105,
      "pose_mae_dx": 0.11255855113267899,
      "pose_mae_dy": 0.0650114044547081,
      "pose_rmse_dtheta": 0.5252817869186401,
      "pose_rmse_dx": 0.23840543627738953,
      "pose_rmse_dy": 0.14067605137825012,
      "pose_rmse_mean": 0.30145442485809326,
      "rmse_dtheta": 0.056431520730257034,
      "rmse_dx": 0.023811278864741325,
      "rmse_dy": 0.01199815608561039,
      "rmse_mean": 0.030746985226869583,
      "rotation_flip": 0.019455252215266228,
      "sparse_tokens": 23838.0,
      "step": 4799,
      "turn_loss": 0.3023148775100708,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.22300687604534472,
      "grad_norm": 0.7380650639533997,
      "learning_rate": 6.636589257553104e-06,
      "loss": 0.1666,
      "mae_dtheta": 0.01261038240045309,
      "mae_dx": 0.00282032391987741,
      "mae_dy": 0.004148520063608885,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7380650639533997,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.0071563720703,
      "model/head/act_norm_mean": 103.03020438762626,
      "model/head/act_norm_min": 62.13860321044922,
      "model/head/act_over_embed": 70.8033210391475,
      "model/head/grad_frac": 0.11755690723657608,
      "model/head/grad_norm": 0.08676464855670929,
      "model/head/grad_zero_frac": 0.00011041057587135583,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6972360321969697,
      "model/head/update_ratio": 0.0014870362356305122,
      "model/head/weight_delta": 8.145309448242188,
      "model/head/weight_delta_rel": 0.14289285242557526,
      "model/head/weight_norm": 58.34736633300781,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41948169469833374,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41942064073350693,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4193553328514099,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2882297909899703,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08064234256744385,
      "model/modality_embedder.encoders.pose/grad_norm": 0.059519294649362564,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5392447916666666,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019257805543020368,
      "model/modality_embedder.encoders.pose/weight_delta": 2.6718809604644775,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0872986763715744,
      "model/modality_embedder.encoders.pose/weight_norm": 30.90658187866211,
      "model/modality_embedder/grad_frac": 0.08064234256744385,
      "model/modality_embedder/grad_norm": 0.059519294649362564,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5392447916666666,
      "model/modality_embedder/update_ratio": 0.0019257805543020368,
      "model/modality_embedder/weight_delta": 2.6718809604644775,
      "model/modality_embedder/weight_delta_rel": 0.0872986763715744,
      "model/modality_embedder/weight_norm": 30.90658187866211,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.99984741210938,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.02381703944204,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.1708984375,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.822182621875776,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11084631830453873,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.08181179314851761,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002943018451333046,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.9873422384262085,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07241994887590408,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.798601150512695,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.58174896240234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.042741402116402,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.301007270812988,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.522396983225775,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10940582305192947,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.08074861764907837,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 9.0784378699027e-05,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0027370224706828594,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.515742778778076,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0871472954750061,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.50235939025879,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.68841552734375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.97260551948052,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.288814544677734,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.848617672350926,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11335910856723785,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.08366639912128448,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002747081685811281,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.704709529876709,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09081908315420151,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.456464767456055,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.47340393066406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.886714365881033,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.490863800048828,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.164011191766715,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12428916990756989,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.09173349291086197,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 7.06100690877065e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0030840307008475065,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.3064863681793213,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07882475852966309,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.744674682617188,
      "model/normalizer/grad_frac": 0.4507635533809662,
      "model/normalizer/grad_norm": 0.33269283175468445,
      "model/normalizer/grad_zero_frac": 8.981212158687413e-05,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004245887044817209,
      "model/normalizer/weight_delta": 4.898524284362793,
      "model/normalizer/weight_delta_rel": 0.06309015303850174,
      "model/normalizer/weight_norm": 78.35649871826172,
      "pose_mae_dtheta": 0.08792048692703247,
      "pose_mae_dx": 0.029608935117721558,
      "pose_mae_dy": 0.03173072636127472,
      "pose_rmse_dtheta": 0.2278560847043991,
      "pose_rmse_dx": 0.08538724482059479,
      "pose_rmse_dy": 0.07173598557710648,
      "pose_rmse_mean": 0.1283264458179474,
      "rmse_dtheta": 0.027102403342723846,
      "rmse_dx": 0.006925511173903942,
      "rmse_dy": 0.009932313114404678,
      "rmse_mean": 0.014653409831225872,
      "rotation_flip": 0.0030374620109796524,
      "sparse_tokens": 32121.0,
      "step": 4800,
      "turn_loss": 0.1294465959072113,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.22300687604534472,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3152187466621399,
      "eval_objectnav_nopose_mae_dtheta": 0.04072332754731178,
      "eval_objectnav_nopose_mae_dx": 0.013946257531642914,
      "eval_objectnav_nopose_mae_dy": 0.004955269396305084,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32776305079460144,
      "eval_objectnav_nopose_pose_mae_dx": 0.11209633946418762,
      "eval_objectnav_nopose_pose_mae_dy": 0.05703750625252724,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5487883687019348,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2432500720024109,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13184711337089539,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3079618811607361,
      "eval_objectnav_nopose_rmse_dtheta": 0.0582251101732254,
      "eval_objectnav_nopose_rmse_dx": 0.02688627876341343,
      "eval_objectnav_nopose_rmse_dy": 0.009933140128850937,
      "eval_objectnav_nopose_rmse_mean": 0.03168150782585144,
      "eval_objectnav_nopose_rotation_flip": 0.012829314917325974,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3152187466621399,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 4800
    },
    {
      "epoch": 0.22300687604534472,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28581586480140686,
      "eval_objectnav_pose_mae_dtheta": 0.03657056763768196,
      "eval_objectnav_pose_mae_dx": 0.011717935092747211,
      "eval_objectnav_pose_mae_dy": 0.00462066475301981,
      "eval_objectnav_pose_pose_mae_dtheta": 0.28064200282096863,
      "eval_objectnav_pose_pose_mae_dx": 0.09261230379343033,
      "eval_objectnav_pose_pose_mae_dy": 0.05016358196735382,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4896261692047119,
      "eval_objectnav_pose_pose_rmse_dx": 0.2096458524465561,
      "eval_objectnav_pose_pose_rmse_dy": 0.12012454122304916,
      "eval_objectnav_pose_pose_rmse_mean": 0.27313220500946045,
      "eval_objectnav_pose_rmse_dtheta": 0.05432716757059097,
      "eval_objectnav_pose_rmse_dx": 0.023961612954735756,
      "eval_objectnav_pose_rmse_dy": 0.009578999131917953,
      "eval_objectnav_pose_rmse_mean": 0.029289260506629944,
      "eval_objectnav_pose_rotation_flip": 0.01384594477713108,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28581586480140686,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 4800
    },
    {
      "epoch": 0.22300687604534472,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09877324849367142,
      "eval_pointnav_mae_dtheta": 0.011360365897417068,
      "eval_pointnav_mae_dx": 0.002692094538360834,
      "eval_pointnav_mae_dy": 0.002583139343187213,
      "eval_pointnav_pose_mae_dtheta": 0.08014052361249924,
      "eval_pointnav_pose_mae_dx": 0.029797323048114777,
      "eval_pointnav_pose_mae_dy": 0.029071448370814323,
      "eval_pointnav_pose_rmse_dtheta": 0.22372165322303772,
      "eval_pointnav_pose_rmse_dx": 0.08712294697761536,
      "eval_pointnav_pose_rmse_dy": 0.08372637629508972,
      "eval_pointnav_pose_rmse_mean": 0.13152366876602173,
      "eval_pointnav_rmse_dtheta": 0.02726878970861435,
      "eval_pointnav_rmse_dx": 0.00817923340946436,
      "eval_pointnav_rmse_dy": 0.007161772809922695,
      "eval_pointnav_rmse_mean": 0.014203265309333801,
      "eval_pointnav_rotation_flip": 0.0050278352573513985,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09877324849367142,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 4800
    },
    {
      "epoch": 0.22300687604534472,
      "eval_loss": 0.23326928665240607,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3152187466621399,
      "eval_objectnav_nopose_mae_dtheta": 0.04072332754731178,
      "eval_objectnav_nopose_mae_dx": 0.013946257531642914,
      "eval_objectnav_nopose_mae_dy": 0.004955269396305084,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32776305079460144,
      "eval_objectnav_nopose_pose_mae_dx": 0.11209633946418762,
      "eval_objectnav_nopose_pose_mae_dy": 0.05703750625252724,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5487883687019348,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2432500720024109,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13184711337089539,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3079618811607361,
      "eval_objectnav_nopose_rmse_dtheta": 0.0582251101732254,
      "eval_objectnav_nopose_rmse_dx": 0.02688627876341343,
      "eval_objectnav_nopose_rmse_dy": 0.009933140128850937,
      "eval_objectnav_nopose_rmse_mean": 0.03168150782585144,
      "eval_objectnav_nopose_rotation_flip": 0.012829314917325974,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3152187466621399,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28581586480140686,
      "eval_objectnav_pose_mae_dtheta": 0.03657056763768196,
      "eval_objectnav_pose_mae_dx": 0.011717935092747211,
      "eval_objectnav_pose_mae_dy": 0.00462066475301981,
      "eval_objectnav_pose_pose_mae_dtheta": 0.28064200282096863,
      "eval_objectnav_pose_pose_mae_dx": 0.09261230379343033,
      "eval_objectnav_pose_pose_mae_dy": 0.05016358196735382,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4896261692047119,
      "eval_objectnav_pose_pose_rmse_dx": 0.2096458524465561,
      "eval_objectnav_pose_pose_rmse_dy": 0.12012454122304916,
      "eval_objectnav_pose_pose_rmse_mean": 0.27313220500946045,
      "eval_objectnav_pose_rmse_dtheta": 0.05432716757059097,
      "eval_objectnav_pose_rmse_dx": 0.023961612954735756,
      "eval_objectnav_pose_rmse_dy": 0.009578999131917953,
      "eval_objectnav_pose_rmse_mean": 0.029289260506629944,
      "eval_objectnav_pose_rotation_flip": 0.01384594477713108,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28581586480140686,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09877324849367142,
      "eval_pointnav_mae_dtheta": 0.011360365897417068,
      "eval_pointnav_mae_dx": 0.002692094538360834,
      "eval_pointnav_mae_dy": 0.002583139343187213,
      "eval_pointnav_pose_mae_dtheta": 0.08014052361249924,
      "eval_pointnav_pose_mae_dx": 0.029797323048114777,
      "eval_pointnav_pose_mae_dy": 0.029071448370814323,
      "eval_pointnav_pose_rmse_dtheta": 0.22372165322303772,
      "eval_pointnav_pose_rmse_dx": 0.08712294697761536,
      "eval_pointnav_pose_rmse_dy": 0.08372637629508972,
      "eval_pointnav_pose_rmse_mean": 0.13152366876602173,
      "eval_pointnav_rmse_dtheta": 0.02726878970861435,
      "eval_pointnav_rmse_dx": 0.00817923340946436,
      "eval_pointnav_rmse_dy": 0.007161772809922695,
      "eval_pointnav_rmse_mean": 0.014203265309333801,
      "eval_pointnav_rotation_flip": 0.0050278352573513985,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09877324849367142,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 4800
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.22305333581118753,
      "grad_norm": 0.5319763422012329,
      "learning_rate": 6.635339816587109e-06,
      "loss": 0.0983,
      "mae_dtheta": 0.034364718943834305,
      "mae_dx": 0.013054648414254189,
      "mae_dy": 0.003531831316649914,
      "pose_mae_dtheta": 0.2757873833179474,
      "pose_mae_dx": 0.1045473963022232,
      "pose_mae_dy": 0.039446353912353516,
      "pose_rmse_dtheta": 0.49975496530532837,
      "pose_rmse_dx": 0.2512831687927246,
      "pose_rmse_dy": 0.09252183139324188,
      "pose_rmse_mean": 0.28118667006492615,
      "rmse_dtheta": 0.05405116453766823,
      "rmse_dx": 0.026432309299707413,
      "rmse_dy": 0.007570528890937567,
      "rmse_mean": 0.029351335018873215,
      "rotation_flip": 0.008118080906569958,
      "sparse_tokens": 23258.0,
      "step": 4801,
      "turn_loss": 0.25121772289276123,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.2230997955770303,
      "grad_norm": 0.7432975769042969,
      "learning_rate": 6.634090261260925e-06,
      "loss": 0.1306,
      "mae_dtheta": 0.021556565538048744,
      "mae_dx": 0.02676747739315033,
      "mae_dy": 0.007198361214250326,
      "pose_mae_dtheta": 0.13983343541622162,
      "pose_mae_dx": 0.2130213975906372,
      "pose_mae_dy": 0.08791899681091309,
      "pose_rmse_dtheta": 0.2150164544582367,
      "pose_rmse_dx": 0.3835950791835785,
      "pose_rmse_dy": 0.1531497836112976,
      "pose_rmse_mean": 0.2505871057510376,
      "rmse_dtheta": 0.03268280252814293,
      "rmse_dx": 0.040678687393665314,
      "rmse_dy": 0.011342286132276058,
      "rmse_mean": 0.028234591707587242,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 2240.0,
      "step": 4802,
      "turn_loss": 0.34986400604248047,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 63189.0,
      "epoch": 0.22314625534287308,
      "grad_norm": 0.5912009477615356,
      "learning_rate": 6.63284059166193e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.012633816339075565,
      "mae_dx": 0.002681769197806716,
      "mae_dy": 0.0036742559168487787,
      "pose_mae_dtheta": 0.08227474242448807,
      "pose_mae_dx": 0.032782237976789474,
      "pose_mae_dy": 0.02939102239906788,
      "pose_rmse_dtheta": 0.2215740829706192,
      "pose_rmse_dx": 0.099573515355587,
      "pose_rmse_dy": 0.06295088678598404,
      "pose_rmse_mean": 0.1280328333377838,
      "rmse_dtheta": 0.02806413173675537,
      "rmse_dx": 0.008297356776893139,
      "rmse_dy": 0.009204885922372341,
      "rmse_mean": 0.01518879272043705,
      "rotation_flip": 0.0059947543777525425,
      "sparse_tokens": 31989.0,
      "step": 4803,
      "turn_loss": 0.11700773984193802,
      "turns": 194.0,
      "turns_per_sample": 194.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.22319271510871586,
      "grad_norm": 0.6208928823471069,
      "learning_rate": 6.631590807877517e-06,
      "loss": 0.1781,
      "mae_dtheta": 0.03698909655213356,
      "mae_dx": 0.016656221821904182,
      "mae_dy": 0.003259526565670967,
      "pose_mae_dtheta": 0.33682015538215637,
      "pose_mae_dx": 0.13117653131484985,
      "pose_mae_dy": 0.035860199481248856,
      "pose_rmse_dtheta": 0.5651832818984985,
      "pose_rmse_dx": 0.27121612429618835,
      "pose_rmse_dy": 0.07542522996664047,
      "pose_rmse_mean": 0.303941547870636,
      "rmse_dtheta": 0.05516442283987999,
      "rmse_dx": 0.02912254072725773,
      "rmse_dy": 0.006115331780165434,
      "rmse_mean": 0.03013410046696663,
      "rotation_flip": 0.01304347813129425,
      "sparse_tokens": 8262.0,
      "step": 4804,
      "turn_loss": 0.24456912279129028,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 32662.0,
      "epoch": 0.22323917487455863,
      "grad_norm": 0.5286862254142761,
      "learning_rate": 6.630340909995083e-06,
      "loss": 0.1991,
      "mae_dtheta": 0.03323397785425186,
      "mae_dx": 0.012553120031952858,
      "mae_dy": 0.008128289133310318,
      "pose_mae_dtheta": 0.24087588489055634,
      "pose_mae_dx": 0.10725685954093933,
      "pose_mae_dy": 0.10468212515115738,
      "pose_rmse_dtheta": 0.4004424512386322,
      "pose_rmse_dx": 0.22209085524082184,
      "pose_rmse_dy": 0.23483754694461823,
      "pose_rmse_mean": 0.2857902944087982,
      "rmse_dtheta": 0.04899768903851509,
      "rmse_dx": 0.024620739743113518,
      "rmse_dy": 0.015755126252770424,
      "rmse_mean": 0.02979118376970291,
      "rotation_flip": 0.009733938612043858,
      "sparse_tokens": 26514.0,
      "step": 4805,
      "turn_loss": 0.32168999314308167,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.2232856346404014,
      "grad_norm": 0.7057324647903442,
      "learning_rate": 6.629090898102034e-06,
      "loss": 0.0956,
      "mae_dtheta": 0.008485143072903156,
      "mae_dx": 0.0021776254288852215,
      "mae_dy": 0.0013772596139460802,
      "pose_mae_dtheta": 0.06246331334114075,
      "pose_mae_dx": 0.02368978224694729,
      "pose_mae_dy": 0.019991053268313408,
      "pose_rmse_dtheta": 0.15459638833999634,
      "pose_rmse_dx": 0.08012650907039642,
      "pose_rmse_dy": 0.055596791207790375,
      "pose_rmse_mean": 0.09677322953939438,
      "rmse_dtheta": 0.01929672621190548,
      "rmse_dx": 0.00825477484613657,
      "rmse_dy": 0.003597788978368044,
      "rmse_mean": 0.01038309745490551,
      "rotation_flip": 0.0071151359006762505,
      "sparse_tokens": 32025.0,
      "step": 4806,
      "turn_loss": 0.06921986490488052,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22333209440624419,
      "grad_norm": 0.5270269513130188,
      "learning_rate": 6.627840772285784e-06,
      "loss": 0.1206,
      "mae_dtheta": 0.012375833466649055,
      "mae_dx": 0.0014467396540567279,
      "mae_dy": 0.0022859254386276007,
      "pose_mae_dtheta": 0.08449205011129379,
      "pose_mae_dx": 0.021768683567643166,
      "pose_mae_dy": 0.03160828724503517,
      "pose_rmse_dtheta": 0.1921297162771225,
      "pose_rmse_dx": 0.05272239074110985,
      "pose_rmse_dy": 0.06875177472829819,
      "pose_rmse_mean": 0.10453462600708008,
      "rmse_dtheta": 0.024866262450814247,
      "rmse_dx": 0.004755230154842138,
      "rmse_dy": 0.00438285805284977,
      "rmse_mean": 0.01133478432893753,
      "rotation_flip": 0.004103966988623142,
      "sparse_tokens": 32105.0,
      "step": 4807,
      "turn_loss": 0.0795426294207573,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.22337855417208696,
      "grad_norm": 0.6086507439613342,
      "learning_rate": 6.626590532633755e-06,
      "loss": 0.2117,
      "mae_dtheta": 0.03973707556724548,
      "mae_dx": 0.014327461831271648,
      "mae_dy": 0.005540802609175444,
      "pose_mae_dtheta": 0.31864097714424133,
      "pose_mae_dx": 0.10772182792425156,
      "pose_mae_dy": 0.06903153657913208,
      "pose_rmse_dtheta": 0.5216323137283325,
      "pose_rmse_dx": 0.2238841950893402,
      "pose_rmse_dy": 0.16507300734519958,
      "pose_rmse_mean": 0.30352985858917236,
      "rmse_dtheta": 0.05604330450296402,
      "rmse_dx": 0.02619720995426178,
      "rmse_dy": 0.010517600923776627,
      "rmse_mean": 0.030919373035430908,
      "rotation_flip": 0.01594746671617031,
      "sparse_tokens": 17703.0,
      "step": 4808,
      "turn_loss": 0.3315025269985199,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 35363.0,
      "epoch": 0.22342501393792974,
      "grad_norm": 1.0031397342681885,
      "learning_rate": 6.625340179233377e-06,
      "loss": 0.2983,
      "mae_dtheta": 0.033625926822423935,
      "mae_dx": 0.010346531867980957,
      "mae_dy": 0.006667288485914469,
      "pose_mae_dtheta": 0.2684021592140198,
      "pose_mae_dx": 0.08533233404159546,
      "pose_mae_dy": 0.06998467445373535,
      "pose_rmse_dtheta": 0.48452040553092957,
      "pose_rmse_dx": 0.19171123206615448,
      "pose_rmse_dy": 0.17317891120910645,
      "pose_rmse_mean": 0.28313684463500977,
      "rmse_dtheta": 0.05323347449302673,
      "rmse_dx": 0.021894434466958046,
      "rmse_dy": 0.015570501796901226,
      "rmse_mean": 0.030232802033424377,
      "rotation_flip": 0.012210012413561344,
      "sparse_tokens": 26687.0,
      "step": 4809,
      "turn_loss": 0.2976311147212982,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.22347147370377254,
      "grad_norm": 0.583466649055481,
      "learning_rate": 6.624089712172088e-06,
      "loss": 0.0808,
      "mae_dtheta": 0.008128595538437366,
      "mae_dx": 0.001227867673151195,
      "mae_dy": 0.0007515752222388983,
      "pose_mae_dtheta": 0.057472776621580124,
      "pose_mae_dx": 0.011467046104371548,
      "pose_mae_dy": 0.01217894721776247,
      "pose_rmse_dtheta": 0.22088585793972015,
      "pose_rmse_dx": 0.03300193324685097,
      "pose_rmse_dy": 0.042447369545698166,
      "pose_rmse_mean": 0.0987783893942833,
      "rmse_dtheta": 0.02639825828373432,
      "rmse_dx": 0.004219565540552139,
      "rmse_dy": 0.0017801867797970772,
      "rmse_mean": 0.010799337178468704,
      "rotation_flip": 0.0,
      "sparse_tokens": 32137.0,
      "step": 4810,
      "turn_loss": 0.04342946037650108,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22351793346961532,
      "grad_norm": 0.537456214427948,
      "learning_rate": 6.622839131537334e-06,
      "loss": 0.1472,
      "mae_dtheta": 0.014135260134935379,
      "mae_dx": 0.003974920604377985,
      "mae_dy": 0.005628163926303387,
      "pose_mae_dtheta": 0.10074528306722641,
      "pose_mae_dx": 0.04635564610362053,
      "pose_mae_dy": 0.05415211617946625,
      "pose_rmse_dtheta": 0.22469860315322876,
      "pose_rmse_dx": 0.11404944211244583,
      "pose_rmse_dy": 0.1402113288640976,
      "pose_rmse_mean": 0.15965312719345093,
      "rmse_dtheta": 0.028344836086034775,
      "rmse_dx": 0.009882109239697456,
      "rmse_dy": 0.012030882760882378,
      "rmse_mean": 0.016752611845731735,
      "rotation_flip": 0.005599104333668947,
      "sparse_tokens": 32105.0,
      "step": 4811,
      "turn_loss": 0.1537984013557434,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2235643932354581,
      "grad_norm": 0.4492681920528412,
      "learning_rate": 6.621588437416569e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.012326554395258427,
      "mae_dx": 0.0015184652293100953,
      "mae_dy": 0.002003512578085065,
      "pose_mae_dtheta": 0.08787789195775986,
      "pose_mae_dx": 0.019289452582597733,
      "pose_mae_dy": 0.025456665083765984,
      "pose_rmse_dtheta": 0.2605011761188507,
      "pose_rmse_dx": 0.046700190752744675,
      "pose_rmse_dy": 0.06917443126440048,
      "pose_rmse_mean": 0.12545859813690186,
      "rmse_dtheta": 0.02898925542831421,
      "rmse_dx": 0.004828372970223427,
      "rmse_dy": 0.004252884536981583,
      "rmse_mean": 0.012690170668065548,
      "rotation_flip": 0.0064850845374166965,
      "sparse_tokens": 32073.0,
      "step": 4812,
      "turn_loss": 0.08359143882989883,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22361085300130087,
      "grad_norm": 0.36255088448524475,
      "learning_rate": 6.6203376298972535e-06,
      "loss": 0.0857,
      "mae_dtheta": 0.008687781170010567,
      "mae_dx": 0.001307547208853066,
      "mae_dy": 0.0011209186632186174,
      "pose_mae_dtheta": 0.05732543021440506,
      "pose_mae_dx": 0.012567082419991493,
      "pose_mae_dy": 0.01609113998711109,
      "pose_rmse_dtheta": 0.20307393372058868,
      "pose_rmse_dx": 0.03214889019727707,
      "pose_rmse_dy": 0.045197464525699615,
      "pose_rmse_mean": 0.09347342699766159,
      "rmse_dtheta": 0.02544296160340309,
      "rmse_dx": 0.004014821723103523,
      "rmse_dy": 0.0025657375808805227,
      "rmse_mean": 0.010674506425857544,
      "rotation_flip": 0.003105590119957924,
      "sparse_tokens": 32105.0,
      "step": 4813,
      "turn_loss": 0.06111608445644379,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.22365731276714365,
      "grad_norm": 0.7048045992851257,
      "learning_rate": 6.619086709066858e-06,
      "loss": 0.1887,
      "mae_dtheta": 0.04811478033661842,
      "mae_dx": 0.011411481536924839,
      "mae_dy": 0.0026132354978471994,
      "pose_mae_dtheta": 0.4078531265258789,
      "pose_mae_dx": 0.09881985187530518,
      "pose_mae_dy": 0.03777856379747391,
      "pose_rmse_dtheta": 0.6853178143501282,
      "pose_rmse_dx": 0.21140781044960022,
      "pose_rmse_dy": 0.08138027042150497,
      "pose_rmse_mean": 0.3260353207588196,
      "rmse_dtheta": 0.06753674149513245,
      "rmse_dx": 0.022947249934077263,
      "rmse_dy": 0.0051439618691802025,
      "rmse_mean": 0.031875986605882645,
      "rotation_flip": 0.005434782709926367,
      "sparse_tokens": 6071.0,
      "step": 4814,
      "turn_loss": 0.31030166149139404,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.22370377253298643,
      "grad_norm": 0.6818873882293701,
      "learning_rate": 6.61783567501286e-06,
      "loss": 0.1755,
      "mae_dtheta": 0.00985470600426197,
      "mae_dx": 0.0017056659562513232,
      "mae_dy": 0.001740703941322863,
      "pose_mae_dtheta": 0.07680295407772064,
      "pose_mae_dx": 0.01803547516465187,
      "pose_mae_dy": 0.018991291522979736,
      "pose_rmse_dtheta": 0.23700986802577972,
      "pose_rmse_dx": 0.05388910323381424,
      "pose_rmse_dy": 0.05129905790090561,
      "pose_rmse_mean": 0.11406601965427399,
      "rmse_dtheta": 0.02644154615700245,
      "rmse_dx": 0.005411150865256786,
      "rmse_dy": 0.0044917333871126175,
      "rmse_mean": 0.012114810757339,
      "rotation_flip": 0.0033057851251214743,
      "sparse_tokens": 32089.0,
      "step": 4815,
      "turn_loss": 0.07969620078802109,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.2237502322988292,
      "grad_norm": 1.1168292760849,
      "learning_rate": 6.616584527822745e-06,
      "loss": 0.2927,
      "mae_dtheta": 0.031824991106987,
      "mae_dx": 0.013477100990712643,
      "mae_dy": 0.006538398563861847,
      "pose_mae_dtheta": 0.24832987785339355,
      "pose_mae_dx": 0.11057967692613602,
      "pose_mae_dy": 0.06419578939676285,
      "pose_rmse_dtheta": 0.4369732141494751,
      "pose_rmse_dx": 0.2585790753364563,
      "pose_rmse_dy": 0.14650867879390717,
      "pose_rmse_mean": 0.28068700432777405,
      "rmse_dtheta": 0.04976992681622505,
      "rmse_dx": 0.027100544422864914,
      "rmse_dy": 0.013941118493676186,
      "rmse_mean": 0.03027052991092205,
      "rotation_flip": 0.01702127605676651,
      "sparse_tokens": 21069.0,
      "step": 4816,
      "turn_loss": 0.33412158489227295,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.22379669206467198,
      "grad_norm": 0.4359826445579529,
      "learning_rate": 6.615333267584007e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.039456069469451904,
      "mae_dx": 0.013006947003304958,
      "mae_dy": 0.0064562344923615456,
      "pose_mae_dtheta": 0.31465137004852295,
      "pose_mae_dx": 0.10418561100959778,
      "pose_mae_dy": 0.05668320134282112,
      "pose_rmse_dtheta": 0.5131958723068237,
      "pose_rmse_dx": 0.2136211097240448,
      "pose_rmse_dy": 0.13736478984355927,
      "pose_rmse_mean": 0.28806060552597046,
      "rmse_dtheta": 0.05766730383038521,
      "rmse_dx": 0.025783007964491844,
      "rmse_dy": 0.015285006724298,
      "rmse_mean": 0.03291177377104759,
      "rotation_flip": 0.00899550225585699,
      "sparse_tokens": 10884.0,
      "step": 4817,
      "turn_loss": 0.3529762029647827,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 21101.0,
      "epoch": 0.22384315183051479,
      "grad_norm": 0.5974380373954773,
      "learning_rate": 6.614081894384145e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.036158692091703415,
      "mae_dx": 0.016695601865649223,
      "mae_dy": 0.005173859652131796,
      "pose_mae_dtheta": 0.28293484449386597,
      "pose_mae_dx": 0.12963402271270752,
      "pose_mae_dy": 0.06985605508089066,
      "pose_rmse_dtheta": 0.469229519367218,
      "pose_rmse_dx": 0.27660441398620605,
      "pose_rmse_dy": 0.14741040766239166,
      "pose_rmse_mean": 0.2977481186389923,
      "rmse_dtheta": 0.05278860777616501,
      "rmse_dx": 0.03072819486260414,
      "rmse_dy": 0.009973312728106976,
      "rmse_mean": 0.031163372099399567,
      "rotation_flip": 0.011470281518995762,
      "sparse_tokens": 17486.0,
      "step": 4818,
      "turn_loss": 0.26066267490386963,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 63141.0,
      "epoch": 0.22388961159635756,
      "grad_norm": 0.5545575618743896,
      "learning_rate": 6.612830408310671e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.007789251394569874,
      "mae_dx": 0.0014350272249430418,
      "mae_dy": 0.001587666803970933,
      "pose_mae_dtheta": 0.06030241400003433,
      "pose_mae_dx": 0.018965791910886765,
      "pose_mae_dy": 0.01971672847867012,
      "pose_rmse_dtheta": 0.19520193338394165,
      "pose_rmse_dx": 0.057600244879722595,
      "pose_rmse_dy": 0.0534200482070446,
      "pose_rmse_mean": 0.10207407921552658,
      "rmse_dtheta": 0.022244032472372055,
      "rmse_dx": 0.004905262496322393,
      "rmse_dy": 0.003961368463933468,
      "rmse_mean": 0.010370220988988876,
      "rotation_flip": 0.0035481962841004133,
      "sparse_tokens": 31941.0,
      "step": 4819,
      "turn_loss": 0.057386692613363266,
      "turns": 194.0,
      "turns_per_sample": 194.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.22393607136220034,
      "grad_norm": 0.47925809025764465,
      "learning_rate": 6.6115788094511e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.015945103019475937,
      "mae_dx": 0.005490216892212629,
      "mae_dy": 0.00222778576426208,
      "pose_mae_dtheta": 0.10031957924365997,
      "pose_mae_dx": 0.032867103815078735,
      "pose_mae_dy": 0.035551175475120544,
      "pose_rmse_dtheta": 0.16457457840442657,
      "pose_rmse_dx": 0.08228522539138794,
      "pose_rmse_dy": 0.08458920568227768,
      "pose_rmse_mean": 0.11048300564289093,
      "rmse_dtheta": 0.029399102553725243,
      "rmse_dx": 0.015230230055749416,
      "rmse_dy": 0.005164102651178837,
      "rmse_mean": 0.01659781113266945,
      "rotation_flip": 0.007194244768470526,
      "sparse_tokens": 4420.0,
      "step": 4820,
      "turn_loss": 0.1418265849351883,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22398253112804312,
      "grad_norm": 0.49755677580833435,
      "learning_rate": 6.610327097892959e-06,
      "loss": 0.0758,
      "mae_dtheta": 0.0060010068118572235,
      "mae_dx": 0.001130821998231113,
      "mae_dy": 0.0008950436022132635,
      "pose_mae_dtheta": 0.04378378763794899,
      "pose_mae_dx": 0.013741439208388329,
      "pose_mae_dy": 0.013390620239078999,
      "pose_rmse_dtheta": 0.16315725445747375,
      "pose_rmse_dx": 0.03935430198907852,
      "pose_rmse_dy": 0.03912452980875969,
      "pose_rmse_mean": 0.08054536581039429,
      "rmse_dtheta": 0.019791191443800926,
      "rmse_dx": 0.003681395435705781,
      "rmse_dy": 0.002529246499761939,
      "rmse_mean": 0.008667278103530407,
      "rotation_flip": 0.002487562131136656,
      "sparse_tokens": 32105.0,
      "step": 4821,
      "turn_loss": 0.04465804621577263,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.2240289908938859,
      "grad_norm": 0.590472400188446,
      "learning_rate": 6.609075273723777e-06,
      "loss": 0.1253,
      "mae_dtheta": 0.047551557421684265,
      "mae_dx": 0.010560965165495872,
      "mae_dy": 0.004563219845294952,
      "pose_mae_dtheta": 0.37238696217536926,
      "pose_mae_dx": 0.09206811338663101,
      "pose_mae_dy": 0.06455884128808975,
      "pose_rmse_dtheta": 0.656356930732727,
      "pose_rmse_dx": 0.2190292328596115,
      "pose_rmse_dy": 0.17594753205776215,
      "pose_rmse_mean": 0.3504445552825928,
      "rmse_dtheta": 0.07164721190929413,
      "rmse_dx": 0.02408214472234249,
      "rmse_dy": 0.009767754934728146,
      "rmse_mean": 0.035165704786777496,
      "rotation_flip": 0.017902813851833344,
      "sparse_tokens": 6618.0,
      "step": 4822,
      "turn_loss": 0.2919384837150574,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.22407545065972867,
      "grad_norm": 0.40338584780693054,
      "learning_rate": 6.6078233370311004e-06,
      "loss": 0.119,
      "mae_dtheta": 0.04352492839097977,
      "mae_dx": 0.012817608192563057,
      "mae_dy": 0.004427005536854267,
      "pose_mae_dtheta": 0.3867330551147461,
      "pose_mae_dx": 0.09725829213857651,
      "pose_mae_dy": 0.04857435077428818,
      "pose_rmse_dtheta": 0.6208042502403259,
      "pose_rmse_dx": 0.21607112884521484,
      "pose_rmse_dy": 0.1137419193983078,
      "pose_rmse_mean": 0.3168724477291107,
      "rmse_dtheta": 0.061896927654743195,
      "rmse_dx": 0.024795101955533028,
      "rmse_dy": 0.009394347667694092,
      "rmse_mean": 0.032028794288635254,
      "rotation_flip": 0.01123595517128706,
      "sparse_tokens": 21254.0,
      "step": 4823,
      "turn_loss": 0.3469015061855316,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.22412191042557145,
      "grad_norm": 0.6036270260810852,
      "learning_rate": 6.606571287902473e-06,
      "loss": 0.2102,
      "mae_dtheta": 0.03595808148384094,
      "mae_dx": 0.009824314154684544,
      "mae_dy": 0.005526026710867882,
      "pose_mae_dtheta": 0.27910053730010986,
      "pose_mae_dx": 0.07640115916728973,
      "pose_mae_dy": 0.057454172521829605,
      "pose_rmse_dtheta": 0.47505345940589905,
      "pose_rmse_dx": 0.15163372457027435,
      "pose_rmse_dy": 0.13889482617378235,
      "pose_rmse_mean": 0.2551940083503723,
      "rmse_dtheta": 0.05445651710033417,
      "rmse_dx": 0.019838374108076096,
      "rmse_dy": 0.01220129057765007,
      "rmse_mean": 0.02883206307888031,
      "rotation_flip": 0.010241404175758362,
      "sparse_tokens": 22031.0,
      "step": 4824,
      "turn_loss": 0.3062261641025543,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 26848.0,
      "epoch": 0.22416837019141422,
      "grad_norm": 0.49612703919410706,
      "learning_rate": 6.605319126425455e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.03204316273331642,
      "mae_dx": 0.014727517031133175,
      "mae_dy": 0.004990912042558193,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.49612703919410706,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.38865661621094,
      "model/head/act_norm_mean": 110.46086690512048,
      "model/head/act_norm_min": 82.9561538696289,
      "model/head/act_over_embed": 75.90974188812808,
      "model/head/grad_frac": 0.11291597038507462,
      "model/head/grad_norm": 0.05602066591382027,
      "model/head/grad_zero_frac": 0.00015800134860910475,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6939594314759037,
      "model/head/update_ratio": 0.0009600487537682056,
      "model/head/weight_delta": 8.166011810302734,
      "model/head/weight_delta_rel": 0.1432560384273529,
      "model/head/weight_norm": 58.351898193359375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41943129897117615,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41943129897117615,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41943129897117615,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2882371154306806,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07259718328714371,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03601742535829544,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011653341352939606,
      "model/modality_embedder.encoders.pose/weight_delta": 2.672086477279663,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08730539679527283,
      "model/modality_embedder.encoders.pose/weight_norm": 30.907381057739258,
      "model/modality_embedder/grad_frac": 0.07259718328714371,
      "model/modality_embedder/grad_norm": 0.03601742535829544,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0011653341352939606,
      "model/modality_embedder/weight_delta": 2.672086477279663,
      "model/modality_embedder/weight_delta_rel": 0.08730539679527283,
      "model/modality_embedder/weight_norm": 30.907381057739258,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.8418197631836,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.63783407439281,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.037221908569336,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.244140876811997,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08807854354381561,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04369814693927765,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015718437498435378,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 1.9943559169769287,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07267553359270096,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.800567626953125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.55891418457031,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.468723106712563,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.659541130065918,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.81513559872781,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09661448001861572,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04793305695056915,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016245769802480936,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.524751663208008,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08745937049388885,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.504945755004883,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.25020599365234,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.067463305603365,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.02266788482666,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.91380483104713,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10247787088155746,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0508420430123806,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016692026983946562,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.714545488357544,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09114935249090195,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.458879470825195,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.14936828613281,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.97078492541595,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.017765998840332,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.221785267360087,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1073981449007988,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.053283125162124634,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017912256298586726,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.315217971801758,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07912316173315048,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.746740341186523,
      "model/normalizer/grad_frac": 0.41340360045433044,
      "model/normalizer/grad_norm": 0.20510070025920868,
      "model/normalizer/grad_zero_frac": 0.00014653555990662426,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002617435296997428,
      "model/normalizer/weight_delta": 4.91637659072876,
      "model/normalizer/weight_delta_rel": 0.0633200854063034,
      "model/normalizer/weight_norm": 78.35941314697266,
      "pose_mae_dtheta": 0.2601431608200073,
      "pose_mae_dx": 0.1374116986989975,
      "pose_mae_dy": 0.07897483557462692,
      "pose_rmse_dtheta": 0.42109963297843933,
      "pose_rmse_dx": 0.29186028242111206,
      "pose_rmse_dy": 0.17630194127559662,
      "pose_rmse_mean": 0.2964206337928772,
      "rmse_dtheta": 0.046497367322444916,
      "rmse_dx": 0.02937822788953781,
      "rmse_dy": 0.009884435683488846,
      "rmse_mean": 0.028586676344275475,
      "rotation_flip": 0.0071428571827709675,
      "sparse_tokens": 20331.0,
      "step": 4825,
      "turn_loss": 0.25133901834487915,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.22421482995725703,
      "grad_norm": 0.45410871505737305,
      "learning_rate": 6.604066852687607e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.0109409773722291,
      "mae_dx": 0.00425776606425643,
      "mae_dy": 0.0037379784043878317,
      "pose_mae_dtheta": 0.087107352912426,
      "pose_mae_dx": 0.04400967061519623,
      "pose_mae_dy": 0.03342076390981674,
      "pose_rmse_dtheta": 0.24986490607261658,
      "pose_rmse_dx": 0.13096506893634796,
      "pose_rmse_dy": 0.08472755551338196,
      "pose_rmse_mean": 0.15518584847450256,
      "rmse_dtheta": 0.026792924851179123,
      "rmse_dx": 0.01293262280523777,
      "rmse_dy": 0.0088753467425704,
      "rmse_mean": 0.016200300306081772,
      "rotation_flip": 0.005755395628511906,
      "sparse_tokens": 32089.0,
      "step": 4826,
      "turn_loss": 0.11407355219125748,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.2242612897230998,
      "grad_norm": 0.964084804058075,
      "learning_rate": 6.602814466776505e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.030535049736499786,
      "mae_dx": 0.007216291502118111,
      "mae_dy": 0.0032120044343173504,
      "pose_mae_dtheta": 0.2593840956687927,
      "pose_mae_dx": 0.05601264908909798,
      "pose_mae_dy": 0.04290686547756195,
      "pose_rmse_dtheta": 0.488707959651947,
      "pose_rmse_dx": 0.17487657070159912,
      "pose_rmse_dy": 0.09725862741470337,
      "pose_rmse_mean": 0.2536143958568573,
      "rmse_dtheta": 0.050586096942424774,
      "rmse_dx": 0.018358567729592323,
      "rmse_dy": 0.006639179307967424,
      "rmse_mean": 0.025194615125656128,
      "rotation_flip": 0.014109347015619278,
      "sparse_tokens": 10365.0,
      "step": 4827,
      "turn_loss": 0.19438952207565308,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.22430774948894258,
      "grad_norm": 0.7289460897445679,
      "learning_rate": 6.601561968779725e-06,
      "loss": 0.1558,
      "mae_dtheta": 0.03263523057103157,
      "mae_dx": 0.004489557351917028,
      "mae_dy": 0.0037474443670362234,
      "pose_mae_dtheta": 0.27307742834091187,
      "pose_mae_dx": 0.042687203735113144,
      "pose_mae_dy": 0.05183858796954155,
      "pose_rmse_dtheta": 0.509158730506897,
      "pose_rmse_dx": 0.09812016040086746,
      "pose_rmse_dy": 0.10687527060508728,
      "pose_rmse_mean": 0.2380513846874237,
      "rmse_dtheta": 0.05246250331401825,
      "rmse_dx": 0.011707914993166924,
      "rmse_dy": 0.006572198588401079,
      "rmse_mean": 0.023580875247716904,
      "rotation_flip": 0.014522821642458439,
      "sparse_tokens": 8407.0,
      "step": 4828,
      "turn_loss": 0.1980108916759491,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22435420925478536,
      "grad_norm": 0.4465649425983429,
      "learning_rate": 6.600309358784858e-06,
      "loss": 0.0978,
      "mae_dtheta": 0.009975692257285118,
      "mae_dx": 0.0020027209538966417,
      "mae_dy": 0.0031132271979004145,
      "pose_mae_dtheta": 0.0649838000535965,
      "pose_mae_dx": 0.028845539316534996,
      "pose_mae_dy": 0.034991033375263214,
      "pose_rmse_dtheta": 0.13394463062286377,
      "pose_rmse_dx": 0.07414405792951584,
      "pose_rmse_dy": 0.07939133048057556,
      "pose_rmse_mean": 0.09582667797803879,
      "rmse_dtheta": 0.020781012251973152,
      "rmse_dx": 0.005676972679793835,
      "rmse_dy": 0.006632354110479355,
      "rmse_mean": 0.011030113324522972,
      "rotation_flip": 0.0026626093313097954,
      "sparse_tokens": 32073.0,
      "step": 4829,
      "turn_loss": 0.08338254690170288,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.22440066902062814,
      "grad_norm": 0.412478506565094,
      "learning_rate": 6.599056636879499e-06,
      "loss": 0.0932,
      "mae_dtheta": 0.03516541048884392,
      "mae_dx": 0.009417249821126461,
      "mae_dy": 0.006802680436521769,
      "pose_mae_dtheta": 0.30502450466156006,
      "pose_mae_dx": 0.05121993273496628,
      "pose_mae_dy": 0.07057174295186996,
      "pose_rmse_dtheta": 0.5961650609970093,
      "pose_rmse_dx": 0.11139509081840515,
      "pose_rmse_dy": 0.1968154013156891,
      "pose_rmse_mean": 0.30145853757858276,
      "rmse_dtheta": 0.05578961968421936,
      "rmse_dx": 0.019756751134991646,
      "rmse_dy": 0.014481269754469395,
      "rmse_mean": 0.030009213835000992,
      "rotation_flip": 0.009966777637600899,
      "sparse_tokens": 6255.0,
      "step": 4830,
      "turn_loss": 0.22076164186000824,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2244471287864709,
      "grad_norm": 0.5015681982040405,
      "learning_rate": 6.5978038031512505e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.0087313586845994,
      "mae_dx": 0.0012769846944138408,
      "mae_dy": 0.0014176219701766968,
      "pose_mae_dtheta": 0.05920979753136635,
      "pose_mae_dx": 0.01611836440861225,
      "pose_mae_dy": 0.019524697214365005,
      "pose_rmse_dtheta": 0.188288614153862,
      "pose_rmse_dx": 0.04143824055790901,
      "pose_rmse_dy": 0.051529210060834885,
      "pose_rmse_mean": 0.09375201910734177,
      "rmse_dtheta": 0.02383016236126423,
      "rmse_dx": 0.003995110280811787,
      "rmse_dy": 0.0032160384580492973,
      "rmse_mean": 0.010347104631364346,
      "rotation_flip": 0.003035559318959713,
      "sparse_tokens": 32121.0,
      "step": 4831,
      "turn_loss": 0.05922171473503113,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2244935885523137,
      "grad_norm": 0.4989315867424011,
      "learning_rate": 6.596550857687724e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.01228618249297142,
      "mae_dx": 0.0025586707051843405,
      "mae_dy": 0.004069636110216379,
      "pose_mae_dtheta": 0.07948024570941925,
      "pose_mae_dx": 0.03706848993897438,
      "pose_mae_dy": 0.0453391969203949,
      "pose_rmse_dtheta": 0.16684174537658691,
      "pose_rmse_dx": 0.09009968489408493,
      "pose_rmse_dy": 0.1099105253815651,
      "pose_rmse_mean": 0.12228398770093918,
      "rmse_dtheta": 0.02359873056411743,
      "rmse_dx": 0.006409917026758194,
      "rmse_dy": 0.008659407496452332,
      "rmse_mean": 0.012889351695775986,
      "rotation_flip": 0.004993342328816652,
      "sparse_tokens": 32169.0,
      "step": 4832,
      "turn_loss": 0.11304173618555069,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.22454004831815647,
      "grad_norm": 0.6611794233322144,
      "learning_rate": 6.59529780057654e-06,
      "loss": 0.1528,
      "mae_dtheta": 0.02996322512626648,
      "mae_dx": 0.008896056562662125,
      "mae_dy": 0.004663587082177401,
      "pose_mae_dtheta": 0.2244238257408142,
      "pose_mae_dx": 0.07552913576364517,
      "pose_mae_dy": 0.05359874293208122,
      "pose_rmse_dtheta": 0.4071866273880005,
      "pose_rmse_dx": 0.1983676701784134,
      "pose_rmse_dy": 0.11020548641681671,
      "pose_rmse_mean": 0.23858658969402313,
      "rmse_dtheta": 0.04666581004858017,
      "rmse_dx": 0.020870892331004143,
      "rmse_dy": 0.009062495082616806,
      "rmse_mean": 0.02553306519985199,
      "rotation_flip": 0.00792752020061016,
      "sparse_tokens": 14988.0,
      "step": 4833,
      "turn_loss": 0.24540157616138458,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.22458650808399927,
      "grad_norm": 0.43411359190940857,
      "learning_rate": 6.5940446319053254e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.011758504435420036,
      "mae_dx": 0.0013919848715886474,
      "mae_dy": 0.0026291930116713047,
      "pose_mae_dtheta": 0.0774158164858818,
      "pose_mae_dx": 0.021118253469467163,
      "pose_mae_dy": 0.031245246529579163,
      "pose_rmse_dtheta": 0.1890721619129181,
      "pose_rmse_dx": 0.05136922746896744,
      "pose_rmse_dy": 0.06258466094732285,
      "pose_rmse_mean": 0.10100868344306946,
      "rmse_dtheta": 0.025227302685379982,
      "rmse_dx": 0.0038848556578159332,
      "rmse_dy": 0.00526121212169528,
      "rmse_mean": 0.011457789689302444,
      "rotation_flip": 0.0022346368059515953,
      "sparse_tokens": 32057.0,
      "step": 4834,
      "turn_loss": 0.0933251604437828,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.22463296784984205,
      "grad_norm": 0.798810601234436,
      "learning_rate": 6.5927913517617125e-06,
      "loss": 0.1862,
      "mae_dtheta": 0.039942268282175064,
      "mae_dx": 0.012734529562294483,
      "mae_dy": 0.005791918374598026,
      "pose_mae_dtheta": 0.3073914051055908,
      "pose_mae_dx": 0.0917966365814209,
      "pose_mae_dy": 0.0798780620098114,
      "pose_rmse_dtheta": 0.5334921479225159,
      "pose_rmse_dx": 0.18154610693454742,
      "pose_rmse_dy": 0.18669085204601288,
      "pose_rmse_mean": 0.300576388835907,
      "rmse_dtheta": 0.05806388333439827,
      "rmse_dx": 0.02432028390467167,
      "rmse_dy": 0.012124764733016491,
      "rmse_mean": 0.03150297701358795,
      "rotation_flip": 0.007299270015209913,
      "sparse_tokens": 6579.0,
      "step": 4835,
      "turn_loss": 0.3225695490837097,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.22467942761568482,
      "grad_norm": 0.6852680444717407,
      "learning_rate": 6.591537960233345e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.019133979454636574,
      "mae_dx": 0.006941112224012613,
      "mae_dy": 0.0023612212389707565,
      "pose_mae_dtheta": 0.1578221470117569,
      "pose_mae_dx": 0.06996066123247147,
      "pose_mae_dy": 0.03415302187204361,
      "pose_rmse_dtheta": 0.3220691978931427,
      "pose_rmse_dx": 0.18334822356700897,
      "pose_rmse_dy": 0.0866345539689064,
      "pose_rmse_mean": 0.1973506659269333,
      "rmse_dtheta": 0.03561574965715408,
      "rmse_dx": 0.01789640448987484,
      "rmse_dy": 0.004584291018545628,
      "rmse_mean": 0.019365482032299042,
      "rotation_flip": 0.005102040711790323,
      "sparse_tokens": 9999.0,
      "step": 4836,
      "turn_loss": 0.15514755249023438,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.2247258873815276,
      "grad_norm": 0.6057518124580383,
      "learning_rate": 6.590284457407876e-06,
      "loss": 0.1449,
      "mae_dtheta": 0.03160327672958374,
      "mae_dx": 0.010946819558739662,
      "mae_dy": 0.006364221218973398,
      "pose_mae_dtheta": 0.24633389711380005,
      "pose_mae_dx": 0.08869339525699615,
      "pose_mae_dy": 0.08911209553480148,
      "pose_rmse_dtheta": 0.4384368658065796,
      "pose_rmse_dx": 0.21304920315742493,
      "pose_rmse_dy": 0.2154206782579422,
      "pose_rmse_mean": 0.28896892070770264,
      "rmse_dtheta": 0.0485917404294014,
      "rmse_dx": 0.0241746436804533,
      "rmse_dy": 0.012192903086543083,
      "rmse_mean": 0.028319764882326126,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 17990.0,
      "step": 4837,
      "turn_loss": 0.24294567108154297,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.22477234714737038,
      "grad_norm": 0.546972930431366,
      "learning_rate": 6.58903084337296e-06,
      "loss": 0.1382,
      "mae_dtheta": 0.02940981835126877,
      "mae_dx": 0.009444045834243298,
      "mae_dy": 0.004723538178950548,
      "pose_mae_dtheta": 0.23084382712841034,
      "pose_mae_dx": 0.08108166605234146,
      "pose_mae_dy": 0.050767358392477036,
      "pose_rmse_dtheta": 0.38100361824035645,
      "pose_rmse_dx": 0.2028893679380417,
      "pose_rmse_dy": 0.12468884885311127,
      "pose_rmse_mean": 0.2361939549446106,
      "rmse_dtheta": 0.04373512789607048,
      "rmse_dx": 0.02162325568497181,
      "rmse_dy": 0.009308308362960815,
      "rmse_mean": 0.02488889917731285,
      "rotation_flip": 0.01290877815335989,
      "sparse_tokens": 21093.0,
      "step": 4838,
      "turn_loss": 0.2421848177909851,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 39265.0,
      "epoch": 0.22481880691321315,
      "grad_norm": 1.1176981925964355,
      "learning_rate": 6.5877771182162645e-06,
      "loss": 0.3193,
      "mae_dtheta": 0.04162631183862686,
      "mae_dx": 0.013289065100252628,
      "mae_dy": 0.003793519688770175,
      "pose_mae_dtheta": 0.338606059551239,
      "pose_mae_dx": 0.10701257735490799,
      "pose_mae_dy": 0.048823047429323196,
      "pose_rmse_dtheta": 0.5379490852355957,
      "pose_rmse_dx": 0.2372378706932068,
      "pose_rmse_dy": 0.1217670664191246,
      "pose_rmse_mean": 0.29898467659950256,
      "rmse_dtheta": 0.058881137520074844,
      "rmse_dx": 0.026037318632006645,
      "rmse_dy": 0.008845364674925804,
      "rmse_mean": 0.0312546081840992,
      "rotation_flip": 0.011363636702299118,
      "sparse_tokens": 28197.0,
      "step": 4839,
      "turn_loss": 0.3340429961681366,
      "turns": 121.0,
      "turns_per_sample": 121.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.22486526667905593,
      "grad_norm": 0.6266273260116577,
      "learning_rate": 6.586523282025462e-06,
      "loss": 0.1798,
      "mae_dtheta": 0.04899061843752861,
      "mae_dx": 0.012908252887427807,
      "mae_dy": 0.011800735257565975,
      "pose_mae_dtheta": 0.3644729256629944,
      "pose_mae_dx": 0.09665407985448837,
      "pose_mae_dy": 0.12066630274057388,
      "pose_rmse_dtheta": 0.5718907713890076,
      "pose_rmse_dx": 0.1817045956850052,
      "pose_rmse_dy": 0.27724799513816833,
      "pose_rmse_mean": 0.34361445903778076,
      "rmse_dtheta": 0.06743884086608887,
      "rmse_dx": 0.022335849702358246,
      "rmse_dy": 0.025121374055743217,
      "rmse_mean": 0.03829868882894516,
      "rotation_flip": 0.01785714365541935,
      "sparse_tokens": 5724.0,
      "step": 4840,
      "turn_loss": 0.49769338965415955,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.2249117264448987,
      "grad_norm": 0.869215190410614,
      "learning_rate": 6.5852693348882345e-06,
      "loss": 0.1197,
      "mae_dtheta": 0.032202742993831635,
      "mae_dx": 0.00714857829734683,
      "mae_dy": 0.0043248669244349,
      "pose_mae_dtheta": 0.24111904203891754,
      "pose_mae_dx": 0.05263805389404297,
      "pose_mae_dy": 0.06289185583591461,
      "pose_rmse_dtheta": 0.5069465637207031,
      "pose_rmse_dx": 0.151675745844841,
      "pose_rmse_dy": 0.15391062200069427,
      "pose_rmse_mean": 0.27084434032440186,
      "rmse_dtheta": 0.053880445659160614,
      "rmse_dx": 0.01950879953801632,
      "rmse_dy": 0.00849555991590023,
      "rmse_mean": 0.027294937521219254,
      "rotation_flip": 0.006825938355177641,
      "sparse_tokens": 11283.0,
      "step": 4841,
      "turn_loss": 0.25458019971847534,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.22495818621074148,
      "grad_norm": 0.5848613977432251,
      "learning_rate": 6.584015276892273e-06,
      "loss": 0.097,
      "mae_dtheta": 0.01210688054561615,
      "mae_dx": 0.0023677365388721228,
      "mae_dy": 0.002576194703578949,
      "pose_mae_dtheta": 0.083781898021698,
      "pose_mae_dx": 0.029080837965011597,
      "pose_mae_dy": 0.03180108591914177,
      "pose_rmse_dtheta": 0.21944187581539154,
      "pose_rmse_dx": 0.06911038607358932,
      "pose_rmse_dy": 0.08849187940359116,
      "pose_rmse_mean": 0.12568138539791107,
      "rmse_dtheta": 0.027141747996211052,
      "rmse_dx": 0.005948497913777828,
      "rmse_dy": 0.006344281602650881,
      "rmse_mean": 0.013144842348992825,
      "rotation_flip": 0.0024989587254822254,
      "sparse_tokens": 32121.0,
      "step": 4842,
      "turn_loss": 0.10598793625831604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.2250046459765843,
      "grad_norm": 0.7906040549278259,
      "learning_rate": 6.582761108125272e-06,
      "loss": 0.1715,
      "mae_dtheta": 0.03155065327882767,
      "mae_dx": 0.013152280822396278,
      "mae_dy": 0.0035562061239033937,
      "pose_mae_dtheta": 0.2717740833759308,
      "pose_mae_dx": 0.1152341440320015,
      "pose_mae_dy": 0.04500080272555351,
      "pose_rmse_dtheta": 0.42838603258132935,
      "pose_rmse_dx": 0.24920408427715302,
      "pose_rmse_dy": 0.10922635346651077,
      "pose_rmse_mean": 0.2622721791267395,
      "rmse_dtheta": 0.04562462493777275,
      "rmse_dx": 0.025764893740415573,
      "rmse_dy": 0.007411147002130747,
      "rmse_mean": 0.02626688778400421,
      "rotation_flip": 0.007552870083600283,
      "sparse_tokens": 10493.0,
      "step": 4843,
      "turn_loss": 0.2723364531993866,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.22505110574242707,
      "grad_norm": 0.5731738209724426,
      "learning_rate": 6.581506828674937e-06,
      "loss": 0.0935,
      "mae_dtheta": 0.008742326870560646,
      "mae_dx": 0.0014693046687170863,
      "mae_dy": 0.0005107255419716239,
      "pose_mae_dtheta": 0.06463194638490677,
      "pose_mae_dx": 0.010299201123416424,
      "pose_mae_dy": 0.00884472206234932,
      "pose_rmse_dtheta": 0.25245386362075806,
      "pose_rmse_dx": 0.025645900517702103,
      "pose_rmse_dy": 0.028214851394295692,
      "pose_rmse_mean": 0.10210487246513367,
      "rmse_dtheta": 0.029446037486195564,
      "rmse_dx": 0.004591029137372971,
      "rmse_dy": 0.0014717726735398173,
      "rmse_mean": 0.011836281046271324,
      "rotation_flip": 0.0016891892300918698,
      "sparse_tokens": 32201.0,
      "step": 4844,
      "turn_loss": 0.04528114199638367,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22509756550826984,
      "grad_norm": 0.3973306715488434,
      "learning_rate": 6.580252438628982e-06,
      "loss": 0.1015,
      "mae_dtheta": 0.009710394777357578,
      "mae_dx": 0.0017532509518787265,
      "mae_dy": 0.0020021656528115273,
      "pose_mae_dtheta": 0.06949186325073242,
      "pose_mae_dx": 0.023406751453876495,
      "pose_mae_dy": 0.03191318362951279,
      "pose_rmse_dtheta": 0.14942142367362976,
      "pose_rmse_dx": 0.06452389806509018,
      "pose_rmse_dy": 0.08710149675607681,
      "pose_rmse_mean": 0.10034894198179245,
      "rmse_dtheta": 0.019290758296847343,
      "rmse_dx": 0.005787136033177376,
      "rmse_dy": 0.004673252813518047,
      "rmse_mean": 0.009917049668729305,
      "rotation_flip": 0.00296233594417572,
      "sparse_tokens": 32073.0,
      "step": 4845,
      "turn_loss": 0.07793235033750534,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.22514402527411262,
      "grad_norm": 1.3402072191238403,
      "learning_rate": 6.578997938075126e-06,
      "loss": 0.3227,
      "mae_dtheta": 0.03768285736441612,
      "mae_dx": 0.019512074068188667,
      "mae_dy": 0.005358944181352854,
      "pose_mae_dtheta": 0.31391409039497375,
      "pose_mae_dx": 0.15041522681713104,
      "pose_mae_dy": 0.08225692063570023,
      "pose_rmse_dtheta": 0.5626665353775024,
      "pose_rmse_dx": 0.31079962849617004,
      "pose_rmse_dy": 0.1997511237859726,
      "pose_rmse_mean": 0.35773909091949463,
      "rmse_dtheta": 0.05580668896436691,
      "rmse_dx": 0.03445067256689072,
      "rmse_dy": 0.0098625672981143,
      "rmse_mean": 0.033373311161994934,
      "rotation_flip": 0.0032051282469183207,
      "sparse_tokens": 5054.0,
      "step": 4846,
      "turn_loss": 0.37499871850013733,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2251904850399554,
      "grad_norm": 0.7891454696655273,
      "learning_rate": 6.577743327101094e-06,
      "loss": 0.1415,
      "mae_dtheta": 0.013637919910252094,
      "mae_dx": 0.0032049124129116535,
      "mae_dy": 0.0034901832696050406,
      "pose_mae_dtheta": 0.09642674773931503,
      "pose_mae_dx": 0.036193087697029114,
      "pose_mae_dy": 0.045093320310115814,
      "pose_rmse_dtheta": 0.2150062471628189,
      "pose_rmse_dx": 0.10109291970729828,
      "pose_rmse_dy": 0.1240021139383316,
      "pose_rmse_mean": 0.1467004269361496,
      "rmse_dtheta": 0.027156665921211243,
      "rmse_dx": 0.010199157521128654,
      "rmse_dy": 0.008090144023299217,
      "rmse_mean": 0.015148657374083996,
      "rotation_flip": 0.0062157223001122475,
      "sparse_tokens": 32105.0,
      "step": 4847,
      "turn_loss": 0.13664866983890533,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.22523694480579817,
      "grad_norm": 0.9027122855186462,
      "learning_rate": 6.576488605794627e-06,
      "loss": 0.2111,
      "mae_dtheta": 0.03597453609108925,
      "mae_dx": 0.012998377904295921,
      "mae_dy": 0.0051572853699326515,
      "pose_mae_dtheta": 0.2790214419364929,
      "pose_mae_dx": 0.10661805421113968,
      "pose_mae_dy": 0.045757826417684555,
      "pose_rmse_dtheta": 0.4983156621456146,
      "pose_rmse_dx": 0.2244206964969635,
      "pose_rmse_dy": 0.1072048768401146,
      "pose_rmse_mean": 0.27664709091186523,
      "rmse_dtheta": 0.054305508732795715,
      "rmse_dx": 0.024951709434390068,
      "rmse_dy": 0.010132084600627422,
      "rmse_mean": 0.029796434566378593,
      "rotation_flip": 0.010366826318204403,
      "sparse_tokens": 20008.0,
      "step": 4848,
      "turn_loss": 0.3207255005836487,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.22528340457164095,
      "grad_norm": 0.644444465637207,
      "learning_rate": 6.5752337742434644e-06,
      "loss": 0.1129,
      "mae_dtheta": 0.019962990656495094,
      "mae_dx": 0.007318789605051279,
      "mae_dy": 0.004161658696830273,
      "pose_mae_dtheta": 0.15193533897399902,
      "pose_mae_dx": 0.061669062823057175,
      "pose_mae_dy": 0.05163109675049782,
      "pose_rmse_dtheta": 0.2935817241668701,
      "pose_rmse_dx": 0.14148403704166412,
      "pose_rmse_dy": 0.11797942966222763,
      "pose_rmse_mean": 0.18434838950634003,
      "rmse_dtheta": 0.03441309556365013,
      "rmse_dx": 0.0179381612688303,
      "rmse_dy": 0.008178851567208767,
      "rmse_mean": 0.020176704972982407,
      "rotation_flip": 0.010920437052845955,
      "sparse_tokens": 12930.0,
      "step": 4849,
      "turn_loss": 0.18581430613994598,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.22532986433748373,
      "grad_norm": 0.45068785548210144,
      "learning_rate": 6.573978832535359e-06,
      "loss": 0.0902,
      "mae_dtheta": 0.009644330479204655,
      "mae_dx": 0.001240953104570508,
      "mae_dy": 0.0013624703278765082,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.45068785548210144,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 170.25588989257812,
      "model/head/act_norm_mean": 124.98132694128788,
      "model/head/act_norm_min": 66.18326568603516,
      "model/head/act_over_embed": 85.88833796767098,
      "model/head/grad_frac": 0.10420765727758408,
      "model/head/grad_norm": 0.04696512594819069,
      "model/head/grad_zero_frac": 0.00019036306184716523,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7009992503156566,
      "model/head/update_ratio": 0.0008048079325817525,
      "model/head/weight_delta": 8.184537887573242,
      "model/head/weight_delta_rel": 0.14358103275299072,
      "model/head/weight_norm": 58.35569381713867,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41953814029693604,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4194716000886557,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.419402152299881,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2882648107359176,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09060027450323105,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04083244502544403,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5317720334101382,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013210795586928725,
      "model/modality_embedder.encoders.pose/weight_delta": 2.6779143810272217,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08749581128358841,
      "model/modality_embedder.encoders.pose/weight_norm": 30.90839195251465,
      "model/modality_embedder/grad_frac": 0.09060027450323105,
      "model/modality_embedder/grad_norm": 0.04083244502544403,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5317720334101382,
      "model/modality_embedder/update_ratio": 0.0013210795586928725,
      "model/modality_embedder/weight_delta": 2.6779143810272217,
      "model/modality_embedder/weight_delta_rel": 0.08749581128358841,
      "model/modality_embedder/weight_norm": 30.90839195251465,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 94.69559478759766,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.987649310565978,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.09122085571289,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.17174654427954,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09208396077156067,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04150112345814705,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014927888987585902,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.000242233276367,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0728900358080864,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.801067352294922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 95.91525268554688,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.033514710598045,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.320307731628418,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.89047503872772,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09853879362344742,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.044410236179828644,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015050636138767004,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.532538652420044,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08772911876440048,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.50721549987793,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 97.6865005493164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.951030643738978,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.529203414916992,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.208209940049173,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11370090395212173,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0512436181306839,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016822052421048284,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.7239737510681152,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09146593511104584,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.462167739868164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 98.52203369140625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.678546376463043,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.579870223999023,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.395374924834254,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.15028013288974762,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06772942841053009,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002276814077049494,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.322619676589966,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07937611639499664,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.747455596923828,
      "model/normalizer/grad_frac": 0.6124849915504456,
      "model/normalizer/grad_norm": 0.2760395407676697,
      "model/normalizer/grad_zero_frac": 0.00012408253678586334,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0035226151812821627,
      "model/normalizer/weight_delta": 4.93220329284668,
      "model/normalizer/weight_delta_rel": 0.06352392584085464,
      "model/normalizer/weight_norm": 78.36210632324219,
      "pose_mae_dtheta": 0.06526120007038116,
      "pose_mae_dx": 0.014983044005930424,
      "pose_mae_dy": 0.02134564518928528,
      "pose_rmse_dtheta": 0.19220009446144104,
      "pose_rmse_dx": 0.04066472873091698,
      "pose_rmse_dy": 0.05483543127775192,
      "pose_rmse_mean": 0.09590008854866028,
      "rmse_dtheta": 0.024463485926389694,
      "rmse_dx": 0.00423723179847002,
      "rmse_dy": 0.002994251437485218,
      "rmse_mean": 0.010564989410340786,
      "rotation_flip": 0.004759638104587793,
      "sparse_tokens": 32057.0,
      "step": 4850,
      "turn_loss": 0.06142917275428772,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.22537632410332653,
      "grad_norm": 0.3005613088607788,
      "learning_rate": 6.572723780758069e-06,
      "loss": 0.0789,
      "mae_dtheta": 0.025075770914554596,
      "mae_dx": 0.014385763555765152,
      "mae_dy": 0.008370642550289631,
      "pose_mae_dtheta": 0.16245999932289124,
      "pose_mae_dx": 0.12989388406276703,
      "pose_mae_dy": 0.07438164949417114,
      "pose_rmse_dtheta": 0.33924099802970886,
      "pose_rmse_dx": 0.2564992308616638,
      "pose_rmse_dy": 0.18382835388183594,
      "pose_rmse_mean": 0.2598561942577362,
      "rmse_dtheta": 0.04641162231564522,
      "rmse_dx": 0.02677847631275654,
      "rmse_dy": 0.018608972430229187,
      "rmse_mean": 0.030599690973758698,
      "rotation_flip": 0.02958579920232296,
      "sparse_tokens": 3999.0,
      "step": 4851,
      "turn_loss": 0.34743040800094604,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.2254227838691693,
      "grad_norm": 0.568890392780304,
      "learning_rate": 6.571468618999361e-06,
      "loss": 0.156,
      "mae_dtheta": 0.03895627707242966,
      "mae_dx": 0.015038878656923771,
      "mae_dy": 0.0051795197650790215,
      "pose_mae_dtheta": 0.33114907145500183,
      "pose_mae_dx": 0.11853869259357452,
      "pose_mae_dy": 0.07199368625879288,
      "pose_rmse_dtheta": 0.5397480726242065,
      "pose_rmse_dx": 0.2466936856508255,
      "pose_rmse_dy": 0.16172844171524048,
      "pose_rmse_mean": 0.3160567283630371,
      "rmse_dtheta": 0.0542469248175621,
      "rmse_dx": 0.028261734172701836,
      "rmse_dy": 0.010237541049718857,
      "rmse_mean": 0.0309154000133276,
      "rotation_flip": 0.023575639352202415,
      "sparse_tokens": 17630.0,
      "step": 4852,
      "turn_loss": 0.319636732339859,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.22546924363501208,
      "grad_norm": 0.5333621501922607,
      "learning_rate": 6.570213347347009e-06,
      "loss": 0.0896,
      "mae_dtheta": 0.03571624308824539,
      "mae_dx": 0.02063506655395031,
      "mae_dy": 0.009605828672647476,
      "pose_mae_dtheta": 0.28204232454299927,
      "pose_mae_dx": 0.13453057408332825,
      "pose_mae_dy": 0.12589098513126373,
      "pose_rmse_dtheta": 0.4160654842853546,
      "pose_rmse_dx": 0.23723331093788147,
      "pose_rmse_dy": 0.24577701091766357,
      "pose_rmse_mean": 0.29969194531440735,
      "rmse_dtheta": 0.048995744436979294,
      "rmse_dx": 0.03258557617664337,
      "rmse_dy": 0.01346054021269083,
      "rmse_mean": 0.031680621206760406,
      "rotation_flip": 0.012396694160997868,
      "sparse_tokens": 4275.0,
      "step": 4853,
      "turn_loss": 0.2847846448421478,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.22551570340085486,
      "grad_norm": 0.4619576632976532,
      "learning_rate": 6.568957965888793e-06,
      "loss": 0.1647,
      "mae_dtheta": 0.03653458505868912,
      "mae_dx": 0.009834281168878078,
      "mae_dy": 0.0024528284557163715,
      "pose_mae_dtheta": 0.27101436257362366,
      "pose_mae_dx": 0.07267463952302933,
      "pose_mae_dy": 0.023280981928110123,
      "pose_rmse_dtheta": 0.5327025055885315,
      "pose_rmse_dx": 0.16552546620368958,
      "pose_rmse_dy": 0.05462895706295967,
      "pose_rmse_mean": 0.2509523332118988,
      "rmse_dtheta": 0.05778609216213226,
      "rmse_dx": 0.021171066910028458,
      "rmse_dy": 0.0053838021121919155,
      "rmse_mean": 0.028113653883337975,
      "rotation_flip": 0.01309328991919756,
      "sparse_tokens": 9378.0,
      "step": 4854,
      "turn_loss": 0.2562803030014038,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.22556216316669764,
      "grad_norm": 0.506053626537323,
      "learning_rate": 6.567702474712507e-06,
      "loss": 0.1575,
      "mae_dtheta": 0.03508298099040985,
      "mae_dx": 0.012011655606329441,
      "mae_dy": 0.007312097121030092,
      "pose_mae_dtheta": 0.2755768299102783,
      "pose_mae_dx": 0.09523676335811615,
      "pose_mae_dy": 0.08498066663742065,
      "pose_rmse_dtheta": 0.4799276888370514,
      "pose_rmse_dx": 0.22013190388679504,
      "pose_rmse_dy": 0.19284218549728394,
      "pose_rmse_mean": 0.29763394594192505,
      "rmse_dtheta": 0.053612031042575836,
      "rmse_dx": 0.025565965101122856,
      "rmse_dy": 0.013594930991530418,
      "rmse_mean": 0.03092431090772152,
      "rotation_flip": 0.010820559225976467,
      "sparse_tokens": 19301.0,
      "step": 4855,
      "turn_loss": 0.3234264552593231,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.22560862293254041,
      "grad_norm": 0.5754806995391846,
      "learning_rate": 6.566446873905945e-06,
      "loss": 0.1476,
      "mae_dtheta": 0.00700317183509469,
      "mae_dx": 0.0018761728424578905,
      "mae_dy": 0.0010098236380144954,
      "pose_mae_dtheta": 0.050594791769981384,
      "pose_mae_dx": 0.016401249915361404,
      "pose_mae_dy": 0.013480360619723797,
      "pose_rmse_dtheta": 0.14830228686332703,
      "pose_rmse_dx": 0.03821687027812004,
      "pose_rmse_dy": 0.032777104526758194,
      "pose_rmse_mean": 0.07309875637292862,
      "rmse_dtheta": 0.017870677635073662,
      "rmse_dx": 0.005419799592345953,
      "rmse_dy": 0.002135806018486619,
      "rmse_mean": 0.008475428447127342,
      "rotation_flip": 0.00322971330024302,
      "sparse_tokens": 32217.0,
      "step": 4856,
      "turn_loss": 0.0521395169198513,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.2256550826983832,
      "grad_norm": 0.4920659363269806,
      "learning_rate": 6.565191163556912e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.03445419296622276,
      "mae_dx": 0.012546812184154987,
      "mae_dy": 0.0050162672996521,
      "pose_mae_dtheta": 0.26402178406715393,
      "pose_mae_dx": 0.10311075299978256,
      "pose_mae_dy": 0.05739947780966759,
      "pose_rmse_dtheta": 0.46398383378982544,
      "pose_rmse_dx": 0.22741548717021942,
      "pose_rmse_dy": 0.13940253853797913,
      "pose_rmse_mean": 0.2769339680671692,
      "rmse_dtheta": 0.05255771428346634,
      "rmse_dx": 0.025035064667463303,
      "rmse_dy": 0.010211451910436153,
      "rmse_mean": 0.02926807664334774,
      "rotation_flip": 0.014383561909198761,
      "sparse_tokens": 23972.0,
      "step": 4857,
      "turn_loss": 0.29784566164016724,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.22570154246422597,
      "grad_norm": 0.4440574645996094,
      "learning_rate": 6.563935343753221e-06,
      "loss": 0.1269,
      "mae_dtheta": 0.004606759641319513,
      "mae_dx": 0.00173036172054708,
      "mae_dy": 0.0006324975984171033,
      "pose_mae_dtheta": 0.034442149102687836,
      "pose_mae_dx": 0.015438640490174294,
      "pose_mae_dy": 0.012171742506325245,
      "pose_rmse_dtheta": 0.1009698286652565,
      "pose_rmse_dx": 0.06658602505922318,
      "pose_rmse_dy": 0.027633776888251305,
      "pose_rmse_mean": 0.06506320834159851,
      "rmse_dtheta": 0.015352933667600155,
      "rmse_dx": 0.006910410244017839,
      "rmse_dy": 0.002102168742567301,
      "rmse_mean": 0.008121837861835957,
      "rotation_flip": 0.001054852269589901,
      "sparse_tokens": 32041.0,
      "step": 4858,
      "turn_loss": 0.0360686257481575,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22574800223006877,
      "grad_norm": 0.41730359196662903,
      "learning_rate": 6.562679414582691e-06,
      "loss": 0.1252,
      "mae_dtheta": 0.009816602803766727,
      "mae_dx": 0.0017576244426891208,
      "mae_dy": 0.0028121620416641235,
      "pose_mae_dtheta": 0.06542923301458359,
      "pose_mae_dx": 0.026757804676890373,
      "pose_mae_dy": 0.029396958649158478,
      "pose_rmse_dtheta": 0.15554730594158173,
      "pose_rmse_dx": 0.06760648638010025,
      "pose_rmse_dy": 0.06376131623983383,
      "pose_rmse_mean": 0.09563837945461273,
      "rmse_dtheta": 0.020118074491620064,
      "rmse_dx": 0.005124857649207115,
      "rmse_dy": 0.0062625110149383545,
      "rmse_mean": 0.010501815006136894,
      "rotation_flip": 0.0024570024106651545,
      "sparse_tokens": 32073.0,
      "step": 4859,
      "turn_loss": 0.07824298739433289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.22579446199591155,
      "grad_norm": 0.4371214210987091,
      "learning_rate": 6.561423376133151e-06,
      "loss": 0.1618,
      "mae_dtheta": 0.011745881289243698,
      "mae_dx": 0.0028753019869327545,
      "mae_dy": 0.0027562740724533796,
      "pose_mae_dtheta": 0.08607617020606995,
      "pose_mae_dx": 0.0348825640976429,
      "pose_mae_dy": 0.03407233953475952,
      "pose_rmse_dtheta": 0.1896861046552658,
      "pose_rmse_dx": 0.08480178564786911,
      "pose_rmse_dy": 0.06834380328655243,
      "pose_rmse_mean": 0.11427722871303558,
      "rmse_dtheta": 0.02287626452744007,
      "rmse_dx": 0.008459556847810745,
      "rmse_dy": 0.005460308399051428,
      "rmse_mean": 0.01226537674665451,
      "rotation_flip": 0.005091649480164051,
      "sparse_tokens": 32121.0,
      "step": 4860,
      "turn_loss": 0.10186588764190674,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.22584092176175433,
      "grad_norm": 0.8047782778739929,
      "learning_rate": 6.560167228492436e-06,
      "loss": 0.131,
      "mae_dtheta": 0.0130339739844203,
      "mae_dx": 0.0019152751192450523,
      "mae_dy": 0.0024441673886030912,
      "pose_mae_dtheta": 0.09248269349336624,
      "pose_mae_dx": 0.025954771786928177,
      "pose_mae_dy": 0.03364530950784683,
      "pose_rmse_dtheta": 0.227437824010849,
      "pose_rmse_dx": 0.06419175863265991,
      "pose_rmse_dy": 0.08015467971563339,
      "pose_rmse_mean": 0.12392809242010117,
      "rmse_dtheta": 0.027483230456709862,
      "rmse_dx": 0.0057894461788237095,
      "rmse_dy": 0.005597191397100687,
      "rmse_mean": 0.012956622987985611,
      "rotation_flip": 0.0062500000931322575,
      "sparse_tokens": 32057.0,
      "step": 4861,
      "turn_loss": 0.08574272692203522,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2258873815275971,
      "grad_norm": 0.3388283848762512,
      "learning_rate": 6.55891097174839e-06,
      "loss": 0.1251,
      "mae_dtheta": 0.008481034077703953,
      "mae_dx": 0.001309978892095387,
      "mae_dy": 0.0016711996868252754,
      "pose_mae_dtheta": 0.056605014950037,
      "pose_mae_dx": 0.017486732453107834,
      "pose_mae_dy": 0.023350756615400314,
      "pose_rmse_dtheta": 0.13588394224643707,
      "pose_rmse_dx": 0.05068817362189293,
      "pose_rmse_dy": 0.060067109763622284,
      "pose_rmse_mean": 0.08221307396888733,
      "rmse_dtheta": 0.019671708345413208,
      "rmse_dx": 0.00433775782585144,
      "rmse_dy": 0.003897925140336156,
      "rmse_mean": 0.009302464313805103,
      "rotation_flip": 0.0029296875,
      "sparse_tokens": 32057.0,
      "step": 4862,
      "turn_loss": 0.06264150142669678,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.22593384129343988,
      "grad_norm": 0.524770200252533,
      "learning_rate": 6.557654605988864e-06,
      "loss": 0.1371,
      "mae_dtheta": 0.022532712668180466,
      "mae_dx": 0.0047791688703000546,
      "mae_dy": 0.0025719706900417805,
      "pose_mae_dtheta": 0.17259348928928375,
      "pose_mae_dx": 0.04057193547487259,
      "pose_mae_dy": 0.04251047596335411,
      "pose_rmse_dtheta": 0.3538264036178589,
      "pose_rmse_dx": 0.08606795966625214,
      "pose_rmse_dy": 0.09552324563264847,
      "pose_rmse_mean": 0.17847254872322083,
      "rmse_dtheta": 0.04163643717765808,
      "rmse_dx": 0.012296590954065323,
      "rmse_dy": 0.00462768878787756,
      "rmse_mean": 0.019520239904522896,
      "rotation_flip": 0.01498127356171608,
      "sparse_tokens": 6173.0,
      "step": 4863,
      "turn_loss": 0.16008077561855316,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.22598030105928266,
      "grad_norm": 0.4869678318500519,
      "learning_rate": 6.556398131301714e-06,
      "loss": 0.0972,
      "mae_dtheta": 0.02877645753324032,
      "mae_dx": 0.0108979232609272,
      "mae_dy": 0.0033082023728638887,
      "pose_mae_dtheta": 0.22831253707408905,
      "pose_mae_dx": 0.06179104372859001,
      "pose_mae_dy": 0.050301890820264816,
      "pose_rmse_dtheta": 0.4090108573436737,
      "pose_rmse_dx": 0.11604928225278854,
      "pose_rmse_dy": 0.13038772344589233,
      "pose_rmse_mean": 0.2184826135635376,
      "rmse_dtheta": 0.04698586091399193,
      "rmse_dx": 0.022765377536416054,
      "rmse_dy": 0.0067994249984622,
      "rmse_mean": 0.02551688812673092,
      "rotation_flip": 0.018656715750694275,
      "sparse_tokens": 5165.0,
      "step": 4864,
      "turn_loss": 0.21991896629333496,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.22602676082512543,
      "grad_norm": 0.5787991285324097,
      "learning_rate": 6.555141547774807e-06,
      "loss": 0.208,
      "mae_dtheta": 0.03703330084681511,
      "mae_dx": 0.007978588342666626,
      "mae_dy": 0.003898999420925975,
      "pose_mae_dtheta": 0.28172698616981506,
      "pose_mae_dx": 0.06161409616470337,
      "pose_mae_dy": 0.03636590391397476,
      "pose_rmse_dtheta": 0.5168247818946838,
      "pose_rmse_dx": 0.13109083473682404,
      "pose_rmse_dy": 0.08160682022571564,
      "pose_rmse_mean": 0.24317413568496704,
      "rmse_dtheta": 0.05741861090064049,
      "rmse_dx": 0.01718648336827755,
      "rmse_dy": 0.008401862345635891,
      "rmse_mean": 0.027668986469507217,
      "rotation_flip": 0.019400352612137794,
      "sparse_tokens": 9542.0,
      "step": 4865,
      "turn_loss": 0.2411254644393921,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.2260732205909682,
      "grad_norm": 0.576792299747467,
      "learning_rate": 6.553884855496016e-06,
      "loss": 0.1459,
      "mae_dtheta": 0.027529850602149963,
      "mae_dx": 0.01007574237883091,
      "mae_dy": 0.006519389804452658,
      "pose_mae_dtheta": 0.1919560730457306,
      "pose_mae_dx": 0.0889890119433403,
      "pose_mae_dy": 0.0936959832906723,
      "pose_rmse_dtheta": 0.30914103984832764,
      "pose_rmse_dx": 0.21338403224945068,
      "pose_rmse_dy": 0.19407610595226288,
      "pose_rmse_mean": 0.23886707425117493,
      "rmse_dtheta": 0.04365513101220131,
      "rmse_dx": 0.02270633727312088,
      "rmse_dy": 0.012114104814827442,
      "rmse_mean": 0.02615852653980255,
      "rotation_flip": 0.015267175622284412,
      "sparse_tokens": 7988.0,
      "step": 4866,
      "turn_loss": 0.21306371688842773,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.22611968035681101,
      "grad_norm": 0.45567235350608826,
      "learning_rate": 6.552628054553225e-06,
      "loss": 0.1121,
      "mae_dtheta": 0.013259923085570335,
      "mae_dx": 0.0019308078335598111,
      "mae_dy": 0.0030892028007656336,
      "pose_mae_dtheta": 0.09703948348760605,
      "pose_mae_dx": 0.026661476120352745,
      "pose_mae_dy": 0.03971394523978233,
      "pose_rmse_dtheta": 0.25919070839881897,
      "pose_rmse_dx": 0.06899107247591019,
      "pose_rmse_dy": 0.11715599149465561,
      "pose_rmse_mean": 0.14844593405723572,
      "rmse_dtheta": 0.030035680159926414,
      "rmse_dx": 0.005158392712473869,
      "rmse_dy": 0.00794287770986557,
      "rmse_mean": 0.014378983527421951,
      "rotation_flip": 0.007012622896581888,
      "sparse_tokens": 32153.0,
      "step": 4867,
      "turn_loss": 0.12544551491737366,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.2261661401226538,
      "grad_norm": 0.5045751929283142,
      "learning_rate": 6.551371145034321e-06,
      "loss": 0.0797,
      "mae_dtheta": 0.02828116901218891,
      "mae_dx": 0.009247645735740662,
      "mae_dy": 0.006465078331530094,
      "pose_mae_dtheta": 0.19282186031341553,
      "pose_mae_dx": 0.0676933005452156,
      "pose_mae_dy": 0.0741044282913208,
      "pose_rmse_dtheta": 0.33691731095314026,
      "pose_rmse_dx": 0.18223221600055695,
      "pose_rmse_dy": 0.14490173757076263,
      "pose_rmse_mean": 0.22135043144226074,
      "rmse_dtheta": 0.04245210811495781,
      "rmse_dx": 0.022884024307131767,
      "rmse_dy": 0.010688357055187225,
      "rmse_mean": 0.025341495871543884,
      "rotation_flip": 0.006410256493836641,
      "sparse_tokens": 5944.0,
      "step": 4868,
      "turn_loss": 0.2201949805021286,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22621259988849657,
      "grad_norm": 0.48919677734375,
      "learning_rate": 6.550114127027199e-06,
      "loss": 0.1619,
      "mae_dtheta": 0.013322168961167336,
      "mae_dx": 0.0020512642804533243,
      "mae_dy": 0.003532895352691412,
      "pose_mae_dtheta": 0.08709175139665604,
      "pose_mae_dx": 0.029232749715447426,
      "pose_mae_dy": 0.03533937782049179,
      "pose_rmse_dtheta": 0.21568679809570312,
      "pose_rmse_dx": 0.0695544183254242,
      "pose_rmse_dy": 0.0723908320069313,
      "pose_rmse_mean": 0.11921068280935287,
      "rmse_dtheta": 0.027967747300863266,
      "rmse_dx": 0.005871366709470749,
      "rmse_dy": 0.007780477404594421,
      "rmse_mean": 0.013873197138309479,
      "rotation_flip": 0.004397835116833448,
      "sparse_tokens": 32073.0,
      "step": 4869,
      "turn_loss": 0.12346352636814117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.22625905965433935,
      "grad_norm": 0.5027627348899841,
      "learning_rate": 6.548857000619765e-06,
      "loss": 0.1391,
      "mae_dtheta": 0.011483419686555862,
      "mae_dx": 0.0019189966842532158,
      "mae_dy": 0.002717822091653943,
      "pose_mae_dtheta": 0.08256406337022781,
      "pose_mae_dx": 0.02571798302233219,
      "pose_mae_dy": 0.03321325033903122,
      "pose_rmse_dtheta": 0.21867413818836212,
      "pose_rmse_dx": 0.06004910171031952,
      "pose_rmse_dy": 0.08124180883169174,
      "pose_rmse_mean": 0.119988352060318,
      "rmse_dtheta": 0.02619973011314869,
      "rmse_dx": 0.005827547051012516,
      "rmse_dy": 0.006310638040304184,
      "rmse_mean": 0.012779305689036846,
      "rotation_flip": 0.004294917453080416,
      "sparse_tokens": 32137.0,
      "step": 4870,
      "turn_loss": 0.09476112574338913,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1014.0,
      "epoch": 0.22630551942018212,
      "grad_norm": 0.4500230550765991,
      "learning_rate": 6.547599765899929e-06,
      "loss": 0.1223,
      "mae_dtheta": 0.051395345479249954,
      "mae_dx": 0.03864435851573944,
      "mae_dy": 0.038998641073703766,
      "pose_mae_dtheta": 0.43171828985214233,
      "pose_mae_dx": 0.37725046277046204,
      "pose_mae_dy": 0.3729235827922821,
      "pose_rmse_dtheta": 0.5893476009368896,
      "pose_rmse_dx": 0.5239314436912537,
      "pose_rmse_dy": 0.4321994483470917,
      "pose_rmse_mean": 0.515159547328949,
      "rmse_dtheta": 0.062487151473760605,
      "rmse_dx": 0.04499558359384537,
      "rmse_dy": 0.04586847126483917,
      "rmse_mean": 0.05111707001924515,
      "rotation_flip": 0.017543859779834747,
      "sparse_tokens": 929.0,
      "step": 4871,
      "turn_loss": 1.3656765222549438,
      "turns": 3.0,
      "turns_per_sample": 3.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2263519791860249,
      "grad_norm": 0.36611124873161316,
      "learning_rate": 6.546342422955612e-06,
      "loss": 0.083,
      "mae_dtheta": 0.009415430948138237,
      "mae_dx": 0.001707865740172565,
      "mae_dy": 0.002416784642264247,
      "pose_mae_dtheta": 0.06083277612924576,
      "pose_mae_dx": 0.020774338394403458,
      "pose_mae_dy": 0.031010214239358902,
      "pose_rmse_dtheta": 0.13028983771800995,
      "pose_rmse_dx": 0.05252288281917572,
      "pose_rmse_dy": 0.07262402772903442,
      "pose_rmse_mean": 0.08514558523893356,
      "rmse_dtheta": 0.01893053576350212,
      "rmse_dx": 0.005916433874517679,
      "rmse_dy": 0.005395392421633005,
      "rmse_mean": 0.010080787353217602,
      "rotation_flip": 0.008146639913320541,
      "sparse_tokens": 32089.0,
      "step": 4872,
      "turn_loss": 0.07660146057605743,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.22639843895186768,
      "grad_norm": 0.4673507809638977,
      "learning_rate": 6.545084971874738e-06,
      "loss": 0.1721,
      "mae_dtheta": 0.04125441610813141,
      "mae_dx": 0.011727898381650448,
      "mae_dy": 0.004620946943759918,
      "pose_mae_dtheta": 0.33504417538642883,
      "pose_mae_dx": 0.09421093761920929,
      "pose_mae_dy": 0.05707242339849472,
      "pose_rmse_dtheta": 0.5884295701980591,
      "pose_rmse_dx": 0.20952612161636353,
      "pose_rmse_dy": 0.1424248367547989,
      "pose_rmse_mean": 0.31346017122268677,
      "rmse_dtheta": 0.061655182391405106,
      "rmse_dx": 0.024147098883986473,
      "rmse_dy": 0.00938370916992426,
      "rmse_mean": 0.03172866255044937,
      "rotation_flip": 0.00913241971284151,
      "sparse_tokens": 17923.0,
      "step": 4873,
      "turn_loss": 0.2510986328125,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.22644489871771045,
      "grad_norm": 0.5708408355712891,
      "learning_rate": 6.543827412745243e-06,
      "loss": 0.0809,
      "mae_dtheta": 0.008927657268941402,
      "mae_dx": 0.0018899915739893913,
      "mae_dy": 0.003341768402606249,
      "pose_mae_dtheta": 0.064631886780262,
      "pose_mae_dx": 0.031027503311634064,
      "pose_mae_dy": 0.03638843446969986,
      "pose_rmse_dtheta": 0.1381065398454666,
      "pose_rmse_dx": 0.10441340506076813,
      "pose_rmse_dy": 0.09030935168266296,
      "pose_rmse_mean": 0.11094310134649277,
      "rmse_dtheta": 0.018010927364230156,
      "rmse_dx": 0.006909915711730719,
      "rmse_dy": 0.008147502318024635,
      "rmse_mean": 0.011022781953215599,
      "rotation_flip": 0.006387225352227688,
      "sparse_tokens": 32057.0,
      "step": 4874,
      "turn_loss": 0.07742036879062653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.22649135848355326,
      "grad_norm": 0.5873280167579651,
      "learning_rate": 6.542569745655069e-06,
      "loss": 0.1466,
      "mae_dtheta": 0.02959883213043213,
      "mae_dx": 0.008127638138830662,
      "mae_dy": 0.00752611318603158,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5873280167579651,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.56349182128906,
      "model/head/act_norm_mean": 118.19287109375,
      "model/head/act_norm_min": 89.46119689941406,
      "model/head/act_over_embed": 81.22324755471799,
      "model/head/grad_frac": 0.10409567505121231,
      "model/head/grad_norm": 0.06113830581307411,
      "model/head/grad_zero_frac": 9.930606756825e-05,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.703125,
      "model/head/update_ratio": 0.0010476097231730819,
      "model/head/weight_delta": 8.200695991516113,
      "model/head/weight_delta_rel": 0.1438644975423813,
      "model/head/weight_norm": 58.35980987548828,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4195640981197357,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4195640981197357,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4195640981197357,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.288328376248856,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07149212807416916,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04198933020234108,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.00135850440710783,
      "model/modality_embedder.encoders.pose/weight_delta": 2.68119740486145,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08760307729244232,
      "model/modality_embedder.encoders.pose/weight_norm": 30.908498764038086,
      "model/modality_embedder/grad_frac": 0.07149212807416916,
      "model/modality_embedder/grad_norm": 0.04198933020234108,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.00135850440710783,
      "model/modality_embedder/weight_delta": 2.68119740486145,
      "model/modality_embedder/weight_delta_rel": 0.08760307729244232,
      "model/modality_embedder/weight_norm": 30.908498764038086,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.78778076171875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.370533776661706,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.302305221557617,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.74765897185387,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07865864783525467,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04619842767715454,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016616794746369123,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.006850481033325,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07313084602355957,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.802249908447266,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 77.19960021972656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.202361576140873,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.854667663574219,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.319298823350508,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08774362504482269,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05153429135680199,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017463673138990998,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.5412752628326416,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08803176134824753,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.509422302246094,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.53581237792969,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.876991877480158,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.548894882202148,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.47012044456676,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0893186703324318,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05245935916900635,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001722008571960032,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.7330355644226074,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0917702168226242,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.464052200317383,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.32061767578125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.842383975074405,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.768183708190918,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.820756294324244,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11734283715486526,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06891873478889465,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0023166495375335217,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.3309991359710693,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07966248691082001,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.749313354492188,
      "model/normalizer/grad_frac": 0.49179598689079285,
      "model/normalizer/grad_norm": 0.28884556889533997,
      "model/normalizer/grad_zero_frac": 0.00012408253678586334,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0036859195679426193,
      "model/normalizer/weight_delta": 4.949073791503906,
      "model/normalizer/weight_delta_rel": 0.06374120712280273,
      "model/normalizer/weight_norm": 78.36458587646484,
      "pose_mae_dtheta": 0.22502148151397705,
      "pose_mae_dx": 0.07148005068302155,
      "pose_mae_dy": 0.1201375350356102,
      "pose_rmse_dtheta": 0.37597575783729553,
      "pose_rmse_dx": 0.15807850658893585,
      "pose_rmse_dy": 0.2031574845314026,
      "pose_rmse_mean": 0.2457372546195984,
      "rmse_dtheta": 0.04233750328421593,
      "rmse_dx": 0.018718266859650612,
      "rmse_dy": 0.01311479415744543,
      "rmse_mean": 0.02472352236509323,
      "rotation_flip": 0.013100436888635159,
      "sparse_tokens": 4227.0,
      "step": 4875,
      "turn_loss": 0.17549175024032593,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 31693.0,
      "epoch": 0.22653781824939603,
      "grad_norm": 0.7188532948493958,
      "learning_rate": 6.5413119706921635e-06,
      "loss": 0.2011,
      "mae_dtheta": 0.036554038524627686,
      "mae_dx": 0.011683084070682526,
      "mae_dy": 0.004727592691779137,
      "pose_mae_dtheta": 0.310229629278183,
      "pose_mae_dx": 0.08869029581546783,
      "pose_mae_dy": 0.05472934991121292,
      "pose_rmse_dtheta": 0.5476979613304138,
      "pose_rmse_dx": 0.20922985672950745,
      "pose_rmse_dy": 0.12323915958404541,
      "pose_rmse_mean": 0.2933890223503113,
      "rmse_dtheta": 0.05579013004899025,
      "rmse_dx": 0.02431623637676239,
      "rmse_dy": 0.008831453509628773,
      "rmse_mean": 0.02964594028890133,
      "rotation_flip": 0.0077220075763762,
      "sparse_tokens": 24155.0,
      "step": 4876,
      "turn_loss": 0.2565374970436096,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2265842780152388,
      "grad_norm": 0.3535374701023102,
      "learning_rate": 6.540054087944485e-06,
      "loss": 0.1171,
      "mae_dtheta": 0.006443284451961517,
      "mae_dx": 0.0016055195592343807,
      "mae_dy": 0.001141978777013719,
      "pose_mae_dtheta": 0.04308144375681877,
      "pose_mae_dx": 0.017001081258058548,
      "pose_mae_dy": 0.018344618380069733,
      "pose_rmse_dtheta": 0.1316925287246704,
      "pose_rmse_dx": 0.05254622548818588,
      "pose_rmse_dy": 0.061245162039995193,
      "pose_rmse_mean": 0.08182797580957413,
      "rmse_dtheta": 0.018530348315835,
      "rmse_dx": 0.006217021960765123,
      "rmse_dy": 0.0029251256491988897,
      "rmse_mean": 0.009224165230989456,
      "rotation_flip": 0.0057929037138819695,
      "sparse_tokens": 32057.0,
      "step": 4877,
      "turn_loss": 0.06019554287195206,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2266307377810816,
      "grad_norm": 0.3575375974178314,
      "learning_rate": 6.538796097499997e-06,
      "loss": 0.0985,
      "mae_dtheta": 0.011049633845686913,
      "mae_dx": 0.0015926329651847482,
      "mae_dy": 0.0030182201880961657,
      "pose_mae_dtheta": 0.07023530453443527,
      "pose_mae_dx": 0.02669653110206127,
      "pose_mae_dy": 0.033185604959726334,
      "pose_rmse_dtheta": 0.17461346089839935,
      "pose_rmse_dx": 0.07399475574493408,
      "pose_rmse_dy": 0.07048735022544861,
      "pose_rmse_mean": 0.10636518895626068,
      "rmse_dtheta": 0.02176106907427311,
      "rmse_dx": 0.004388054367154837,
      "rmse_dy": 0.00642316322773695,
      "rmse_mean": 0.01085742935538292,
      "rotation_flip": 0.0073019349947571754,
      "sparse_tokens": 32041.0,
      "step": 4878,
      "turn_loss": 0.08805534243583679,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.22667719754692436,
      "grad_norm": 0.5355846881866455,
      "learning_rate": 6.537537999446673e-06,
      "loss": 0.1344,
      "mae_dtheta": 0.02946675755083561,
      "mae_dx": 0.009286985732614994,
      "mae_dy": 0.006106883753091097,
      "pose_mae_dtheta": 0.18038630485534668,
      "pose_mae_dx": 0.05568864196538925,
      "pose_mae_dy": 0.08091986924409866,
      "pose_rmse_dtheta": 0.356675922870636,
      "pose_rmse_dx": 0.12175900489091873,
      "pose_rmse_dy": 0.1723739355802536,
      "pose_rmse_mean": 0.21693629026412964,
      "rmse_dtheta": 0.0493125393986702,
      "rmse_dx": 0.021489886566996574,
      "rmse_dy": 0.011451907455921173,
      "rmse_mean": 0.027418112382292747,
      "rotation_flip": 0.009836065582931042,
      "sparse_tokens": 4842.0,
      "step": 4879,
      "turn_loss": 0.23394018411636353,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.22672365731276714,
      "grad_norm": 0.547822892665863,
      "learning_rate": 6.536279793872491e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.02966727875173092,
      "mae_dx": 0.004024943802505732,
      "mae_dy": 0.0026295981369912624,
      "pose_mae_dtheta": 0.24638718366622925,
      "pose_mae_dx": 0.029894689098000526,
      "pose_mae_dy": 0.046988118439912796,
      "pose_rmse_dtheta": 0.47989052534103394,
      "pose_rmse_dx": 0.07713117450475693,
      "pose_rmse_dy": 0.11178359389305115,
      "pose_rmse_mean": 0.22293508052825928,
      "rmse_dtheta": 0.05381310358643532,
      "rmse_dx": 0.010641693137586117,
      "rmse_dy": 0.005329026374965906,
      "rmse_mean": 0.02326127514243126,
      "rotation_flip": 0.026894865557551384,
      "sparse_tokens": 6545.0,
      "step": 4880,
      "turn_loss": 0.13695970177650452,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 20065.0,
      "epoch": 0.22677011707860992,
      "grad_norm": 0.6041004657745361,
      "learning_rate": 6.535021480865439e-06,
      "loss": 0.1244,
      "mae_dtheta": 0.02961660549044609,
      "mae_dx": 0.010376280173659325,
      "mae_dy": 0.004356470424681902,
      "pose_mae_dtheta": 0.20668180286884308,
      "pose_mae_dx": 0.09471992403268814,
      "pose_mae_dy": 0.062321897596120834,
      "pose_rmse_dtheta": 0.3681364059448242,
      "pose_rmse_dx": 0.20584945380687714,
      "pose_rmse_dy": 0.1447407454252243,
      "pose_rmse_mean": 0.2395755499601364,
      "rmse_dtheta": 0.0475599430501461,
      "rmse_dx": 0.02169160358607769,
      "rmse_dy": 0.008486543782055378,
      "rmse_mean": 0.025912698358297348,
      "rotation_flip": 0.01614639349281788,
      "sparse_tokens": 15278.0,
      "step": 4881,
      "turn_loss": 0.2288319170475006,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.2268165768444527,
      "grad_norm": 0.5751418471336365,
      "learning_rate": 6.533763060513511e-06,
      "loss": 0.1805,
      "mae_dtheta": 0.04556660354137421,
      "mae_dx": 0.012659172527492046,
      "mae_dy": 0.0065764011815190315,
      "pose_mae_dtheta": 0.3469361960887909,
      "pose_mae_dx": 0.09652919322252274,
      "pose_mae_dy": 0.05061091482639313,
      "pose_rmse_dtheta": 0.5719572901725769,
      "pose_rmse_dx": 0.20559221506118774,
      "pose_rmse_dy": 0.12457795441150665,
      "pose_rmse_mean": 0.30070915818214417,
      "rmse_dtheta": 0.06416600942611694,
      "rmse_dx": 0.023969946429133415,
      "rmse_dy": 0.014813149347901344,
      "rmse_mean": 0.03431636840105057,
      "rotation_flip": 0.01225490216165781,
      "sparse_tokens": 6882.0,
      "step": 4882,
      "turn_loss": 0.4182009994983673,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.22686303661029547,
      "grad_norm": 0.5696132183074951,
      "learning_rate": 6.532504532904708e-06,
      "loss": 0.2124,
      "mae_dtheta": 0.03684650734066963,
      "mae_dx": 0.014161674305796623,
      "mae_dy": 0.007490446325391531,
      "pose_mae_dtheta": 0.27489715814590454,
      "pose_mae_dx": 0.1163724809885025,
      "pose_mae_dy": 0.09088189899921417,
      "pose_rmse_dtheta": 0.46282726526260376,
      "pose_rmse_dx": 0.231733039021492,
      "pose_rmse_dy": 0.1774415522813797,
      "pose_rmse_mean": 0.2906672954559326,
      "rmse_dtheta": 0.053312353789806366,
      "rmse_dx": 0.026732461526989937,
      "rmse_dy": 0.01328482199460268,
      "rmse_mean": 0.031109880656003952,
      "rotation_flip": 0.011347517371177673,
      "sparse_tokens": 13045.0,
      "step": 4883,
      "turn_loss": 0.34255552291870117,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.22690949637613828,
      "grad_norm": 0.6743101477622986,
      "learning_rate": 6.531245898127041e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.027611998841166496,
      "mae_dx": 0.012146593071520329,
      "mae_dy": 0.004089102614670992,
      "pose_mae_dtheta": 0.21904756128787994,
      "pose_mae_dx": 0.08913742750883102,
      "pose_mae_dy": 0.06232323870062828,
      "pose_rmse_dtheta": 0.3786413371562958,
      "pose_rmse_dx": 0.1987258493900299,
      "pose_rmse_dy": 0.1531630903482437,
      "pose_rmse_mean": 0.24351009726524353,
      "rmse_dtheta": 0.042137689888477325,
      "rmse_dx": 0.024705350399017334,
      "rmse_dy": 0.007667476776987314,
      "rmse_mean": 0.024836838245391846,
      "rotation_flip": 0.02539682574570179,
      "sparse_tokens": 5560.0,
      "step": 4884,
      "turn_loss": 0.19708365201950073,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22695595614198105,
      "grad_norm": 0.36824148893356323,
      "learning_rate": 6.529987156268527e-06,
      "loss": 0.0841,
      "mae_dtheta": 0.008721692487597466,
      "mae_dx": 0.0017282468033954501,
      "mae_dy": 0.0023327006492763758,
      "pose_mae_dtheta": 0.056928448379039764,
      "pose_mae_dx": 0.018765686079859734,
      "pose_mae_dy": 0.027076497673988342,
      "pose_rmse_dtheta": 0.12315388768911362,
      "pose_rmse_dx": 0.04586636275053024,
      "pose_rmse_dy": 0.056852493435144424,
      "pose_rmse_mean": 0.07529091835021973,
      "rmse_dtheta": 0.01879338175058365,
      "rmse_dx": 0.0057090576738119125,
      "rmse_dy": 0.005186381749808788,
      "rmse_mean": 0.009896273724734783,
      "rotation_flip": 0.006519967224448919,
      "sparse_tokens": 32073.0,
      "step": 4885,
      "turn_loss": 0.07734739780426025,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22700241590782383,
      "grad_norm": 0.50626140832901,
      "learning_rate": 6.5287283074171884e-06,
      "loss": 0.1294,
      "mae_dtheta": 0.00775313563644886,
      "mae_dx": 0.0011837350903078914,
      "mae_dy": 0.0015981800388544798,
      "pose_mae_dtheta": 0.05232175812125206,
      "pose_mae_dx": 0.015886014327406883,
      "pose_mae_dy": 0.021690675988793373,
      "pose_rmse_dtheta": 0.12360803037881851,
      "pose_rmse_dx": 0.04262688383460045,
      "pose_rmse_dy": 0.053200364112854004,
      "pose_rmse_mean": 0.07314509153366089,
      "rmse_dtheta": 0.0169373806566,
      "rmse_dx": 0.0038463431410491467,
      "rmse_dy": 0.0035258710850030184,
      "rmse_mean": 0.008103199303150177,
      "rotation_flip": 0.0009596928721293807,
      "sparse_tokens": 32073.0,
      "step": 4886,
      "turn_loss": 0.06476228684186935,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2270488756736666,
      "grad_norm": 0.4768558144569397,
      "learning_rate": 6.52746935166106e-06,
      "loss": 0.0879,
      "mae_dtheta": 0.009413301013410091,
      "mae_dx": 0.001994714140892029,
      "mae_dy": 0.00227282103151083,
      "pose_mae_dtheta": 0.06690670549869537,
      "pose_mae_dx": 0.02315056324005127,
      "pose_mae_dy": 0.02479463815689087,
      "pose_rmse_dtheta": 0.1877625286579132,
      "pose_rmse_dx": 0.053644876927137375,
      "pose_rmse_dy": 0.056772638112306595,
      "pose_rmse_mean": 0.09939335286617279,
      "rmse_dtheta": 0.022564275190234184,
      "rmse_dx": 0.005951331462711096,
      "rmse_dy": 0.005402267444878817,
      "rmse_mean": 0.011305958032608032,
      "rotation_flip": 0.0030177291482686996,
      "sparse_tokens": 32137.0,
      "step": 4887,
      "turn_loss": 0.07685665041208267,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.22709533543950938,
      "grad_norm": 0.9069031476974487,
      "learning_rate": 6.526210289088179e-06,
      "loss": 0.2713,
      "mae_dtheta": 0.032383792102336884,
      "mae_dx": 0.012513840571045876,
      "mae_dy": 0.00724445004016161,
      "pose_mae_dtheta": 0.24425719678401947,
      "pose_mae_dx": 0.10197574645280838,
      "pose_mae_dy": 0.07272549718618393,
      "pose_rmse_dtheta": 0.4422028660774231,
      "pose_rmse_dx": 0.20184297859668732,
      "pose_rmse_dy": 0.14223060011863708,
      "pose_rmse_mean": 0.2620921730995178,
      "rmse_dtheta": 0.04966771975159645,
      "rmse_dx": 0.02379422076046467,
      "rmse_dy": 0.013905302621424198,
      "rmse_mean": 0.02912241593003273,
      "rotation_flip": 0.01693667098879814,
      "sparse_tokens": 22417.0,
      "step": 4888,
      "turn_loss": 0.2901795208454132,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.22714179520535216,
      "grad_norm": 0.4901154041290283,
      "learning_rate": 6.524951119786594e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.030609533190727234,
      "mae_dx": 0.0062179239466786385,
      "mae_dy": 0.005099823232740164,
      "pose_mae_dtheta": 0.24076403677463531,
      "pose_mae_dx": 0.04586535319685936,
      "pose_mae_dy": 0.09560200572013855,
      "pose_rmse_dtheta": 0.4577215611934662,
      "pose_rmse_dx": 0.11353503167629242,
      "pose_rmse_dy": 0.23753444850444794,
      "pose_rmse_mean": 0.26959702372550964,
      "rmse_dtheta": 0.04836811497807503,
      "rmse_dx": 0.015857046470046043,
      "rmse_dy": 0.010302220471203327,
      "rmse_mean": 0.024842461571097374,
      "rotation_flip": 0.0038314175326377153,
      "sparse_tokens": 8670.0,
      "step": 4889,
      "turn_loss": 0.22623848915100098,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.22718825497119494,
      "grad_norm": 0.6198217272758484,
      "learning_rate": 6.52369184384436e-06,
      "loss": 0.1743,
      "mae_dtheta": 0.03621862828731537,
      "mae_dx": 0.013385611586272717,
      "mae_dy": 0.0024898655246943235,
      "pose_mae_dtheta": 0.2806861698627472,
      "pose_mae_dx": 0.0993054062128067,
      "pose_mae_dy": 0.03250841796398163,
      "pose_rmse_dtheta": 0.5276098251342773,
      "pose_rmse_dx": 0.22394511103630066,
      "pose_rmse_dy": 0.08013498038053513,
      "pose_rmse_mean": 0.27722999453544617,
      "rmse_dtheta": 0.05563230440020561,
      "rmse_dx": 0.02558724768459797,
      "rmse_dy": 0.004836451727896929,
      "rmse_mean": 0.02868533693253994,
      "rotation_flip": 0.006507592275738716,
      "sparse_tokens": 8042.0,
      "step": 4890,
      "turn_loss": 0.17301300168037415,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2272347147370377,
      "grad_norm": 0.38139021396636963,
      "learning_rate": 6.522432461349536e-06,
      "loss": 0.0664,
      "mae_dtheta": 0.007409059442579746,
      "mae_dx": 0.0013366518542170525,
      "mae_dy": 0.0010441269259899855,
      "pose_mae_dtheta": 0.05060398578643799,
      "pose_mae_dx": 0.013059314340353012,
      "pose_mae_dy": 0.015356222167611122,
      "pose_rmse_dtheta": 0.16308698058128357,
      "pose_rmse_dx": 0.03293287009000778,
      "pose_rmse_dy": 0.04166198521852493,
      "pose_rmse_mean": 0.07922728359699249,
      "rmse_dtheta": 0.01950930990278721,
      "rmse_dx": 0.00451881717890501,
      "rmse_dy": 0.0024223006330430508,
      "rmse_mean": 0.008816809393465519,
      "rotation_flip": 0.0029215358663350344,
      "sparse_tokens": 32137.0,
      "step": 4891,
      "turn_loss": 0.053230319172143936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.22728117450288052,
      "grad_norm": 0.42283913493156433,
      "learning_rate": 6.521172972390193e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.03964659199118614,
      "mae_dx": 0.013648551888763905,
      "mae_dy": 0.007127995137125254,
      "pose_mae_dtheta": 0.31545746326446533,
      "pose_mae_dx": 0.11279843747615814,
      "pose_mae_dy": 0.06646869331598282,
      "pose_rmse_dtheta": 0.5523436069488525,
      "pose_rmse_dx": 0.22378334403038025,
      "pose_rmse_dy": 0.17413650453090668,
      "pose_rmse_mean": 0.3167545199394226,
      "rmse_dtheta": 0.058583784848451614,
      "rmse_dx": 0.025656364858150482,
      "rmse_dy": 0.016384532675147057,
      "rmse_mean": 0.033541563898324966,
      "rotation_flip": 0.016249999403953552,
      "sparse_tokens": 27535.0,
      "step": 4892,
      "turn_loss": 0.3346361517906189,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2273276342687233,
      "grad_norm": 0.386897474527359,
      "learning_rate": 6.519913377054407e-06,
      "loss": 0.0726,
      "mae_dtheta": 0.007675848435610533,
      "mae_dx": 0.0017436750931665301,
      "mae_dy": 0.001610922277905047,
      "pose_mae_dtheta": 0.051202837377786636,
      "pose_mae_dx": 0.023101577535271645,
      "pose_mae_dy": 0.0223171878606081,
      "pose_rmse_dtheta": 0.12289668619632721,
      "pose_rmse_dx": 0.05896616727113724,
      "pose_rmse_dy": 0.0625252053141594,
      "pose_rmse_mean": 0.08146269619464874,
      "rmse_dtheta": 0.0178061630576849,
      "rmse_dx": 0.005077733192592859,
      "rmse_dy": 0.0040499367751181126,
      "rmse_mean": 0.008977944031357765,
      "rotation_flip": 0.0037418147549033165,
      "sparse_tokens": 32121.0,
      "step": 4893,
      "turn_loss": 0.07508545368909836,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.22737409403456607,
      "grad_norm": 0.5297220349311829,
      "learning_rate": 6.5186536754302645e-06,
      "loss": 0.127,
      "mae_dtheta": 0.03289499506354332,
      "mae_dx": 0.010977552272379398,
      "mae_dy": 0.0038462444208562374,
      "pose_mae_dtheta": 0.2602681517601013,
      "pose_mae_dx": 0.08058224618434906,
      "pose_mae_dy": 0.04791766405105591,
      "pose_rmse_dtheta": 0.4962082505226135,
      "pose_rmse_dx": 0.20643627643585205,
      "pose_rmse_dy": 0.10777708888053894,
      "pose_rmse_mean": 0.27014052867889404,
      "rmse_dtheta": 0.052137646824121475,
      "rmse_dx": 0.023125775158405304,
      "rmse_dy": 0.008735942654311657,
      "rmse_mean": 0.027999788522720337,
      "rotation_flip": 0.016885552555322647,
      "sparse_tokens": 9371.0,
      "step": 4894,
      "turn_loss": 0.2537940442562103,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.22742055380040885,
      "grad_norm": 0.5330758690834045,
      "learning_rate": 6.517393867605854e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.025551117956638336,
      "mae_dx": 0.007342126220464706,
      "mae_dy": 0.004590395372360945,
      "pose_mae_dtheta": 0.18595388531684875,
      "pose_mae_dx": 0.06434109807014465,
      "pose_mae_dy": 0.06325138360261917,
      "pose_rmse_dtheta": 0.3678648769855499,
      "pose_rmse_dx": 0.16033226251602173,
      "pose_rmse_dy": 0.14539611339569092,
      "pose_rmse_mean": 0.22453109920024872,
      "rmse_dtheta": 0.042409319430589676,
      "rmse_dx": 0.018841633573174477,
      "rmse_dy": 0.008436227217316628,
      "rmse_mean": 0.02322906069457531,
      "rotation_flip": 0.01706484705209732,
      "sparse_tokens": 23403.0,
      "step": 4895,
      "turn_loss": 0.20024925470352173,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.22746701356625162,
      "grad_norm": 0.6052882075309753,
      "learning_rate": 6.516133953669277e-06,
      "loss": 0.182,
      "mae_dtheta": 0.021061904728412628,
      "mae_dx": 0.007156830281019211,
      "mae_dy": 0.0022518844343721867,
      "pose_mae_dtheta": 0.14580370485782623,
      "pose_mae_dx": 0.0300641767680645,
      "pose_mae_dy": 0.026447108015418053,
      "pose_rmse_dtheta": 0.3016049265861511,
      "pose_rmse_dx": 0.07400357723236084,
      "pose_rmse_dy": 0.08559645712375641,
      "pose_rmse_mean": 0.1537349820137024,
      "rmse_dtheta": 0.04086340218782425,
      "rmse_dx": 0.016672257333993912,
      "rmse_dy": 0.004612204153090715,
      "rmse_mean": 0.020715955644845963,
      "rotation_flip": 0.0,
      "sparse_tokens": 3955.0,
      "step": 4896,
      "turn_loss": 0.08236239850521088,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.2275134733320944,
      "grad_norm": 1.3189650774002075,
      "learning_rate": 6.514873933708637e-06,
      "loss": 0.299,
      "mae_dtheta": 0.03264562413096428,
      "mae_dx": 0.00896256510168314,
      "mae_dy": 0.005564595572650433,
      "pose_mae_dtheta": 0.25604766607284546,
      "pose_mae_dx": 0.0706571638584137,
      "pose_mae_dy": 0.06501954048871994,
      "pose_rmse_dtheta": 0.48252639174461365,
      "pose_rmse_dx": 0.17160457372665405,
      "pose_rmse_dy": 0.1810537576675415,
      "pose_rmse_mean": 0.2783949077129364,
      "rmse_dtheta": 0.05133787915110588,
      "rmse_dx": 0.020411279052495956,
      "rmse_dy": 0.012818234972655773,
      "rmse_mean": 0.028189130127429962,
      "rotation_flip": 0.021087680011987686,
      "sparse_tokens": 16513.0,
      "step": 4897,
      "turn_loss": 0.22847768664360046,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.22755993309793718,
      "grad_norm": 0.6986348628997803,
      "learning_rate": 6.51361380781205e-06,
      "loss": 0.188,
      "mae_dtheta": 0.011925623752176762,
      "mae_dx": 0.0018288118299096823,
      "mae_dy": 0.0024854906369000673,
      "pose_mae_dtheta": 0.08290152251720428,
      "pose_mae_dx": 0.02103296108543873,
      "pose_mae_dy": 0.02513066492974758,
      "pose_rmse_dtheta": 0.22828850150108337,
      "pose_rmse_dx": 0.04770394042134285,
      "pose_rmse_dy": 0.058290742337703705,
      "pose_rmse_mean": 0.11142773926258087,
      "rmse_dtheta": 0.02648642659187317,
      "rmse_dx": 0.0063071949407458305,
      "rmse_dy": 0.006059765815734863,
      "rmse_mean": 0.012951130047440529,
      "rotation_flip": 0.004084411077201366,
      "sparse_tokens": 32153.0,
      "step": 4898,
      "turn_loss": 0.09881316125392914,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.22760639286377995,
      "grad_norm": 0.5257863402366638,
      "learning_rate": 6.512353576067638e-06,
      "loss": 0.169,
      "mae_dtheta": 0.0331406332552433,
      "mae_dx": 0.01029636524617672,
      "mae_dy": 0.005304636899381876,
      "pose_mae_dtheta": 0.2592983543872833,
      "pose_mae_dx": 0.08880653232336044,
      "pose_mae_dy": 0.06029648706316948,
      "pose_rmse_dtheta": 0.4822331964969635,
      "pose_rmse_dx": 0.20920853316783905,
      "pose_rmse_dy": 0.12735183537006378,
      "pose_rmse_mean": 0.27293118834495544,
      "rmse_dtheta": 0.05164825916290283,
      "rmse_dx": 0.022143570706248283,
      "rmse_dy": 0.009677638299763203,
      "rmse_mean": 0.027823157608509064,
      "rotation_flip": 0.0035587188322097063,
      "sparse_tokens": 15192.0,
      "step": 4899,
      "turn_loss": 0.2771434187889099,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.22765285262962276,
      "grad_norm": 0.4567238390445709,
      "learning_rate": 6.51109323856353e-06,
      "loss": 0.09,
      "mae_dtheta": 0.041767753660678864,
      "mae_dx": 0.013251255266368389,
      "mae_dy": 0.0030536106787621975,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.456723690032959,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.8165740966797,
      "model/head/act_norm_mean": 107.69979281038852,
      "model/head/act_norm_min": 78.41334533691406,
      "model/head/act_over_embed": 74.01230592064533,
      "model/head/grad_frac": 0.10845606029033661,
      "model/head/grad_norm": 0.049534451216459274,
      "model/head/grad_zero_frac": 0.000175134016899392,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6811391469594594,
      "model/head/update_ratio": 0.0008487124578095973,
      "model/head/weight_delta": 8.217538833618164,
      "model/head/weight_delta_rel": 0.1441599726676941,
      "model/head/weight_norm": 58.36423110961914,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41952720284461975,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41952720284461975,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41952720284461975,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2883030214703773,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07569122314453125,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03456997498869896,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011184467002749443,
      "model/modality_embedder.encoders.pose/weight_delta": 2.6857266426086426,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08775106072425842,
      "model/modality_embedder.encoders.pose/weight_norm": 30.908916473388672,
      "model/modality_embedder/grad_frac": 0.07569122314453125,
      "model/modality_embedder/grad_norm": 0.03456997498869896,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0011184467002749443,
      "model/modality_embedder/weight_delta": 2.6857266426086426,
      "model/modality_embedder/weight_delta_rel": 0.08775106072425842,
      "model/modality_embedder/weight_norm": 30.908916473388672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.58202362060547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.41442279332904,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.421640396118164,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.09061055285561,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08572965115308762,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.039154764264822006,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014082773122936487,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.013518810272217,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07337383925914764,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.803306579589844,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.27973175048828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.27554395913771,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 13.037341117858887,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.682381079942697,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09315983951091766,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04254830628633499,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001441727508790791,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.550767183303833,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08836057037115097,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.51202964782715,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.02413940429688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.952900445087945,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.13675308227539,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.835076160746535,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10836847126483917,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04949444904923439,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 9.0784378699027e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016245334409177303,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.7429771423339844,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09210404008626938,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.466869354248047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.91094207763672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.806433665808665,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.12745189666748,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.10884154307723,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.14693103730678558,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06710688769817352,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002255619503557682,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.3385393619537354,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.07992018014192581,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.750978469848633,
      "model/normalizer/grad_frac": 0.5097291469573975,
      "model/normalizer/grad_norm": 0.23280537128448486,
      "model/normalizer/grad_zero_frac": 0.000126446015201509,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0029706924688071012,
      "model/normalizer/weight_delta": 4.96643590927124,
      "model/normalizer/weight_delta_rel": 0.06396482139825821,
      "model/normalizer/weight_norm": 78.36737823486328,
      "pose_mae_dtheta": 0.30857956409454346,
      "pose_mae_dx": 0.10254994034767151,
      "pose_mae_dy": 0.045252732932567596,
      "pose_rmse_dtheta": 0.5362443327903748,
      "pose_rmse_dx": 0.223580002784729,
      "pose_rmse_dy": 0.12444600462913513,
      "pose_rmse_mean": 0.29475677013397217,
      "rmse_dtheta": 0.06150221452116966,
      "rmse_dx": 0.0252915658056736,
      "rmse_dy": 0.006692595314234495,
      "rmse_mean": 0.03116212598979473,
      "rotation_flip": 0.008403361774981022,
      "sparse_tokens": 9239.0,
      "step": 4900,
      "turn_loss": 0.26434528827667236,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.22769931239546554,
      "grad_norm": 0.45930883288383484,
      "learning_rate": 6.5098327953878585e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.010096220299601555,
      "mae_dx": 0.0022814064286649227,
      "mae_dy": 0.003001246601343155,
      "pose_mae_dtheta": 0.06895529478788376,
      "pose_mae_dx": 0.026867404580116272,
      "pose_mae_dy": 0.028579071164131165,
      "pose_rmse_dtheta": 0.1974937915802002,
      "pose_rmse_dx": 0.07404517382383347,
      "pose_rmse_dy": 0.07998232543468475,
      "pose_rmse_mean": 0.11717377603054047,
      "rmse_dtheta": 0.025347169488668442,
      "rmse_dx": 0.007438329979777336,
      "rmse_dy": 0.008337781764566898,
      "rmse_mean": 0.013707759790122509,
      "rotation_flip": 0.0060630557127296925,
      "sparse_tokens": 32121.0,
      "step": 4901,
      "turn_loss": 0.08127887547016144,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2277457721613083,
      "grad_norm": 0.42678144574165344,
      "learning_rate": 6.5085722466287705e-06,
      "loss": 0.1055,
      "mae_dtheta": 0.013421286828815937,
      "mae_dx": 0.001765094930306077,
      "mae_dy": 0.0032572089694440365,
      "pose_mae_dtheta": 0.08687656372785568,
      "pose_mae_dx": 0.027613520622253418,
      "pose_mae_dy": 0.03656977787613869,
      "pose_rmse_dtheta": 0.1886298954486847,
      "pose_rmse_dx": 0.06874257326126099,
      "pose_rmse_dy": 0.07781907916069031,
      "pose_rmse_mean": 0.11173051595687866,
      "rmse_dtheta": 0.02486645057797432,
      "rmse_dx": 0.004755950067192316,
      "rmse_dy": 0.006414128001779318,
      "rmse_mean": 0.012012176215648651,
      "rotation_flip": 0.004188144113868475,
      "sparse_tokens": 32121.0,
      "step": 4902,
      "turn_loss": 0.10288893431425095,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2277922319271511,
      "grad_norm": 0.9349220991134644,
      "learning_rate": 6.507311592374415e-06,
      "loss": 0.1368,
      "mae_dtheta": 0.011461582966148853,
      "mae_dx": 0.0026710298843681812,
      "mae_dy": 0.0031694385688751936,
      "pose_mae_dtheta": 0.08162367343902588,
      "pose_mae_dx": 0.03116108663380146,
      "pose_mae_dy": 0.03340405970811844,
      "pose_rmse_dtheta": 0.18242809176445007,
      "pose_rmse_dx": 0.08375528454780579,
      "pose_rmse_dy": 0.08322355896234512,
      "pose_rmse_mean": 0.11646898090839386,
      "rmse_dtheta": 0.024345993995666504,
      "rmse_dx": 0.008641375228762627,
      "rmse_dy": 0.008213591761887074,
      "rmse_mean": 0.013733654282987118,
      "rotation_flip": 0.0036585365887731314,
      "sparse_tokens": 32073.0,
      "step": 4903,
      "turn_loss": 0.09969691932201385,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22783869169299387,
      "grad_norm": 0.4250689148902893,
      "learning_rate": 6.506050832712952e-06,
      "loss": 0.0872,
      "mae_dtheta": 0.007960106246173382,
      "mae_dx": 0.00112912617623806,
      "mae_dy": 0.001248653745278716,
      "pose_mae_dtheta": 0.056440431624650955,
      "pose_mae_dx": 0.013660757802426815,
      "pose_mae_dy": 0.01808721385896206,
      "pose_rmse_dtheta": 0.16882069408893585,
      "pose_rmse_dx": 0.03682338073849678,
      "pose_rmse_dy": 0.03972533345222473,
      "pose_rmse_mean": 0.08178980648517609,
      "rmse_dtheta": 0.020352087914943695,
      "rmse_dx": 0.004001854453235865,
      "rmse_dy": 0.002640703460201621,
      "rmse_mean": 0.008998215198516846,
      "rotation_flip": 0.0009624639060348272,
      "sparse_tokens": 32073.0,
      "step": 4904,
      "turn_loss": 0.05650161951780319,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.22788515145883664,
      "grad_norm": 0.6371569633483887,
      "learning_rate": 6.504789967732543e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.009187373332679272,
      "mae_dx": 0.001990969991311431,
      "mae_dy": 0.0007591668399982154,
      "pose_mae_dtheta": 0.06811504811048508,
      "pose_mae_dx": 0.018264412879943848,
      "pose_mae_dy": 0.00833742693066597,
      "pose_rmse_dtheta": 0.2658005654811859,
      "pose_rmse_dx": 0.05437874048948288,
      "pose_rmse_dy": 0.03306741267442703,
      "pose_rmse_mean": 0.11774890869855881,
      "rmse_dtheta": 0.031049193814396858,
      "rmse_dx": 0.0059488918632268906,
      "rmse_dy": 0.0029549829196184874,
      "rmse_mean": 0.013317689299583435,
      "rotation_flip": 0.0011312217684462667,
      "sparse_tokens": 32201.0,
      "step": 4905,
      "turn_loss": 0.06067843735218048,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.22793161122467942,
      "grad_norm": 0.6719211339950562,
      "learning_rate": 6.503528997521365e-06,
      "loss": 0.1276,
      "mae_dtheta": 0.03901347517967224,
      "mae_dx": 0.013383707031607628,
      "mae_dy": 0.005814151838421822,
      "pose_mae_dtheta": 0.31234410405158997,
      "pose_mae_dx": 0.11064160615205765,
      "pose_mae_dy": 0.0750528946518898,
      "pose_rmse_dtheta": 0.5222092270851135,
      "pose_rmse_dx": 0.24021606147289276,
      "pose_rmse_dy": 0.1753869652748108,
      "pose_rmse_mean": 0.3126040995121002,
      "rmse_dtheta": 0.05788708105683327,
      "rmse_dx": 0.02649102732539177,
      "rmse_dy": 0.011750735342502594,
      "rmse_mean": 0.03204295039176941,
      "rotation_flip": 0.009233610704541206,
      "sparse_tokens": 17138.0,
      "step": 4906,
      "turn_loss": 0.30696073174476624,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.2279780709905222,
      "grad_norm": 0.6402215361595154,
      "learning_rate": 6.502267922167599e-06,
      "loss": 0.1093,
      "mae_dtheta": 0.05454521253705025,
      "mae_dx": 0.011779568158090115,
      "mae_dy": 0.02611546963453293,
      "pose_mae_dtheta": 0.4747956395149231,
      "pose_mae_dx": 0.18256491422653198,
      "pose_mae_dy": 0.22801640629768372,
      "pose_rmse_dtheta": 0.7279759049415588,
      "pose_rmse_dx": 0.35144326090812683,
      "pose_rmse_dy": 0.41164296865463257,
      "pose_rmse_mean": 0.4970207214355469,
      "rmse_dtheta": 0.07749274373054504,
      "rmse_dx": 0.021479180082678795,
      "rmse_dy": 0.041850920766592026,
      "rmse_mean": 0.04694094881415367,
      "rotation_flip": 0.0,
      "sparse_tokens": 3015.0,
      "step": 4907,
      "turn_loss": 0.6317976117134094,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.228024530756365,
      "grad_norm": 0.6942219138145447,
      "learning_rate": 6.50100674175943e-06,
      "loss": 0.2236,
      "mae_dtheta": 0.04998611658811569,
      "mae_dx": 0.012835011817514896,
      "mae_dy": 0.0034173931926488876,
      "pose_mae_dtheta": 0.4272667169570923,
      "pose_mae_dx": 0.10425643622875214,
      "pose_mae_dy": 0.044425103813409805,
      "pose_rmse_dtheta": 0.6694796681404114,
      "pose_rmse_dx": 0.23228375613689423,
      "pose_rmse_dy": 0.13423405587673187,
      "pose_rmse_mean": 0.3453325033187866,
      "rmse_dtheta": 0.0684247612953186,
      "rmse_dx": 0.025164246559143066,
      "rmse_dy": 0.007437311578541994,
      "rmse_mean": 0.03367543965578079,
      "rotation_flip": 0.01173222903162241,
      "sparse_tokens": 22693.0,
      "step": 4908,
      "turn_loss": 0.35116469860076904,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.22807099052220778,
      "grad_norm": 0.5235645174980164,
      "learning_rate": 6.499745456385054e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.014929703436791897,
      "mae_dx": 0.002786668250337243,
      "mae_dy": 0.0037882160395383835,
      "pose_mae_dtheta": 0.09593529254198074,
      "pose_mae_dx": 0.028819920495152473,
      "pose_mae_dy": 0.0389346182346344,
      "pose_rmse_dtheta": 0.22829876840114594,
      "pose_rmse_dx": 0.07273142784833908,
      "pose_rmse_dy": 0.08126061409711838,
      "pose_rmse_mean": 0.1274302750825882,
      "rmse_dtheta": 0.028919899836182594,
      "rmse_dx": 0.008930526673793793,
      "rmse_dy": 0.009200931526720524,
      "rmse_mean": 0.01568378508090973,
      "rotation_flip": 0.008115737698972225,
      "sparse_tokens": 32089.0,
      "step": 4909,
      "turn_loss": 0.14521543681621552,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13928.0,
      "epoch": 0.22811745028805056,
      "grad_norm": 1.126733660697937,
      "learning_rate": 6.4984840661326734e-06,
      "loss": 0.1499,
      "mae_dtheta": 0.034111712127923965,
      "mae_dx": 0.015602629631757736,
      "mae_dy": 0.0031829229556024075,
      "pose_mae_dtheta": 0.29987388849258423,
      "pose_mae_dx": 0.1483052670955658,
      "pose_mae_dy": 0.05763619765639305,
      "pose_rmse_dtheta": 0.5372931957244873,
      "pose_rmse_dx": 0.3364751935005188,
      "pose_rmse_dy": 0.1185501366853714,
      "pose_rmse_mean": 0.33077284693717957,
      "rmse_dtheta": 0.054849594831466675,
      "rmse_dx": 0.030954480171203613,
      "rmse_dy": 0.005906084086745977,
      "rmse_mean": 0.030570052564144135,
      "rotation_flip": 0.015490533784031868,
      "sparse_tokens": 11148.0,
      "step": 4910,
      "turn_loss": 0.227377250790596,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.22816391005389333,
      "grad_norm": 0.5480440258979797,
      "learning_rate": 6.497222571090497e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.008008102886378765,
      "mae_dx": 0.0009135953732766211,
      "mae_dy": 0.0014349989360198379,
      "pose_mae_dtheta": 0.05590422824025154,
      "pose_mae_dx": 0.014348705299198627,
      "pose_mae_dy": 0.022846020758152008,
      "pose_rmse_dtheta": 0.15466102957725525,
      "pose_rmse_dx": 0.03620997816324234,
      "pose_rmse_dy": 0.06135505065321922,
      "pose_rmse_mean": 0.08407535403966904,
      "rmse_dtheta": 0.01928425393998623,
      "rmse_dx": 0.002860874403268099,
      "rmse_dy": 0.0031916191801428795,
      "rmse_mean": 0.00844558235257864,
      "rotation_flip": 0.001265288912691176,
      "sparse_tokens": 32073.0,
      "step": 4911,
      "turn_loss": 0.05862129107117653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.2282103698197361,
      "grad_norm": 0.41028234362602234,
      "learning_rate": 6.495960971346743e-06,
      "loss": 0.1002,
      "mae_dtheta": 0.03334176912903786,
      "mae_dx": 0.010786863043904305,
      "mae_dy": 0.004357556812465191,
      "pose_mae_dtheta": 0.25107112526893616,
      "pose_mae_dx": 0.08407359570264816,
      "pose_mae_dy": 0.05094507709145546,
      "pose_rmse_dtheta": 0.4714461863040924,
      "pose_rmse_dx": 0.1869334578514099,
      "pose_rmse_dy": 0.10407247394323349,
      "pose_rmse_mean": 0.25415071845054626,
      "rmse_dtheta": 0.051598530262708664,
      "rmse_dx": 0.022253667935729027,
      "rmse_dy": 0.007677821442484856,
      "rmse_mean": 0.02717667445540428,
      "rotation_flip": 0.01608187146484852,
      "sparse_tokens": 13739.0,
      "step": 4912,
      "turn_loss": 0.22340254485607147,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.22825682958557889,
      "grad_norm": 0.6732343435287476,
      "learning_rate": 6.4946992669896355e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.03670334443449974,
      "mae_dx": 0.015841037034988403,
      "mae_dy": 0.008448067121207714,
      "pose_mae_dtheta": 0.29462411999702454,
      "pose_mae_dx": 0.1371202915906906,
      "pose_mae_dy": 0.10386399179697037,
      "pose_rmse_dtheta": 0.4840039312839508,
      "pose_rmse_dx": 0.24752618372440338,
      "pose_rmse_dy": 0.22388134896755219,
      "pose_rmse_mean": 0.3184705078601837,
      "rmse_dtheta": 0.0537717267870903,
      "rmse_dx": 0.02769412286579609,
      "rmse_dy": 0.016170814633369446,
      "rmse_mean": 0.032545555382966995,
      "rotation_flip": 0.009151414036750793,
      "sparse_tokens": 20444.0,
      "step": 4913,
      "turn_loss": 0.31044870615005493,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 18773.0,
      "epoch": 0.22830328935142166,
      "grad_norm": 0.7945000529289246,
      "learning_rate": 6.493437458107405e-06,
      "loss": 0.1341,
      "mae_dtheta": 0.030520636588335037,
      "mae_dx": 0.010138175450265408,
      "mae_dy": 0.0035576047375798225,
      "pose_mae_dtheta": 0.2474505454301834,
      "pose_mae_dx": 0.08345533907413483,
      "pose_mae_dy": 0.037627946585416794,
      "pose_rmse_dtheta": 0.4729810357093811,
      "pose_rmse_dx": 0.19353340566158295,
      "pose_rmse_dy": 0.09921352565288544,
      "pose_rmse_mean": 0.2552426755428314,
      "rmse_dtheta": 0.05103958398103714,
      "rmse_dx": 0.02167748287320137,
      "rmse_dy": 0.007076824549585581,
      "rmse_mean": 0.026597965508699417,
      "rotation_flip": 0.01807228848338127,
      "sparse_tokens": 15246.0,
      "step": 4914,
      "turn_loss": 0.2145385593175888,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.22834974911726444,
      "grad_norm": 0.6322378516197205,
      "learning_rate": 6.4921755447882926e-06,
      "loss": 0.1278,
      "mae_dtheta": 0.02832118794322014,
      "mae_dx": 0.009902995079755783,
      "mae_dy": 0.0029284791089594364,
      "pose_mae_dtheta": 0.21819309890270233,
      "pose_mae_dx": 0.059816859662532806,
      "pose_mae_dy": 0.030030792579054832,
      "pose_rmse_dtheta": 0.47913363575935364,
      "pose_rmse_dx": 0.15777729451656342,
      "pose_rmse_dy": 0.07663970440626144,
      "pose_rmse_mean": 0.23785021901130676,
      "rmse_dtheta": 0.05249237269163132,
      "rmse_dx": 0.021442091092467308,
      "rmse_dy": 0.005659023765474558,
      "rmse_mean": 0.026531163603067398,
      "rotation_flip": 0.001956947147846222,
      "sparse_tokens": 9061.0,
      "step": 4915,
      "turn_loss": 0.1937222182750702,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.22839620888310722,
      "grad_norm": 0.8124212622642517,
      "learning_rate": 6.490913527120543e-06,
      "loss": 0.1706,
      "mae_dtheta": 0.033414166420698166,
      "mae_dx": 0.012027125805616379,
      "mae_dy": 0.006944161839783192,
      "pose_mae_dtheta": 0.2719924747943878,
      "pose_mae_dx": 0.10493217408657074,
      "pose_mae_dy": 0.07325563579797745,
      "pose_rmse_dtheta": 0.4497814476490021,
      "pose_rmse_dx": 0.23923909664154053,
      "pose_rmse_dy": 0.16895072162151337,
      "pose_rmse_mean": 0.2859904170036316,
      "rmse_dtheta": 0.04911212995648384,
      "rmse_dx": 0.024167481809854507,
      "rmse_dy": 0.014662706293165684,
      "rmse_mean": 0.029314106330275536,
      "rotation_flip": 0.015138772316277027,
      "sparse_tokens": 20085.0,
      "step": 4916,
      "turn_loss": 0.3073088228702545,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.22844266864895002,
      "grad_norm": 0.9768111109733582,
      "learning_rate": 6.48965140519241e-06,
      "loss": 0.2966,
      "mae_dtheta": 0.045236747711896896,
      "mae_dx": 0.010187223553657532,
      "mae_dy": 0.005452904384583235,
      "pose_mae_dtheta": 0.3639793395996094,
      "pose_mae_dx": 0.0821157917380333,
      "pose_mae_dy": 0.0569453090429306,
      "pose_rmse_dtheta": 0.6159922480583191,
      "pose_rmse_dx": 0.1624540537595749,
      "pose_rmse_dy": 0.13133114576339722,
      "pose_rmse_mean": 0.3032591640949249,
      "rmse_dtheta": 0.0637718215584755,
      "rmse_dx": 0.019631732255220413,
      "rmse_dy": 0.010257781483232975,
      "rmse_mean": 0.0312204472720623,
      "rotation_flip": 0.01797385700047016,
      "sparse_tokens": 10215.0,
      "step": 4917,
      "turn_loss": 0.3206000328063965,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2284891284147928,
      "grad_norm": 0.5405793190002441,
      "learning_rate": 6.488389179092156e-06,
      "loss": 0.126,
      "mae_dtheta": 0.008396703749895096,
      "mae_dx": 0.0015299313236027956,
      "mae_dy": 0.001971467398107052,
      "pose_mae_dtheta": 0.05492962524294853,
      "pose_mae_dx": 0.016215337440371513,
      "pose_mae_dy": 0.022940872237086296,
      "pose_rmse_dtheta": 0.10492336004972458,
      "pose_rmse_dx": 0.039250001311302185,
      "pose_rmse_dy": 0.04726535826921463,
      "pose_rmse_mean": 0.06381290405988693,
      "rmse_dtheta": 0.016620349138975143,
      "rmse_dx": 0.0047078425996005535,
      "rmse_dy": 0.005307014100253582,
      "rmse_mean": 0.008878402411937714,
      "rotation_flip": 0.006840530317276716,
      "sparse_tokens": 32105.0,
      "step": 4918,
      "turn_loss": 0.076309934258461,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.22853558818063557,
      "grad_norm": 0.8304151296615601,
      "learning_rate": 6.4871268489080465e-06,
      "loss": 0.186,
      "mae_dtheta": 0.02635175548493862,
      "mae_dx": 0.010475904680788517,
      "mae_dy": 0.006152505055069923,
      "pose_mae_dtheta": 0.1498604565858841,
      "pose_mae_dx": 0.07550112158060074,
      "pose_mae_dy": 0.04617002606391907,
      "pose_rmse_dtheta": 0.22508206963539124,
      "pose_rmse_dx": 0.13068787753582,
      "pose_rmse_dy": 0.10462289303541183,
      "pose_rmse_mean": 0.15346428751945496,
      "rmse_dtheta": 0.039186879992485046,
      "rmse_dx": 0.01855454035103321,
      "rmse_dy": 0.014349798671901226,
      "rmse_mean": 0.024030406028032303,
      "rotation_flip": 0.015228426083922386,
      "sparse_tokens": 3415.0,
      "step": 4919,
      "turn_loss": 0.32500699162483215,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.22858204794647835,
      "grad_norm": 0.6348856687545776,
      "learning_rate": 6.485864414728359e-06,
      "loss": 0.2728,
      "mae_dtheta": 0.04256428778171539,
      "mae_dx": 0.012697821483016014,
      "mae_dy": 0.005919743329286575,
      "pose_mae_dtheta": 0.38966333866119385,
      "pose_mae_dx": 0.09462198615074158,
      "pose_mae_dy": 0.051416754722595215,
      "pose_rmse_dtheta": 0.5687830448150635,
      "pose_rmse_dx": 0.19507475197315216,
      "pose_rmse_dy": 0.13181822001934052,
      "pose_rmse_mean": 0.29855868220329285,
      "rmse_dtheta": 0.05698360875248909,
      "rmse_dx": 0.02319716475903988,
      "rmse_dy": 0.011877025477588177,
      "rmse_mean": 0.03068593144416809,
      "rotation_flip": 0.019571295008063316,
      "sparse_tokens": 15726.0,
      "step": 4920,
      "turn_loss": 0.3382907807826996,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.22862850771232113,
      "grad_norm": 0.5407837629318237,
      "learning_rate": 6.484601876641375e-06,
      "loss": 0.1262,
      "mae_dtheta": 0.027496177703142166,
      "mae_dx": 0.011195325292646885,
      "mae_dy": 0.003177038626745343,
      "pose_mae_dtheta": 0.21674765646457672,
      "pose_mae_dx": 0.09113489836454391,
      "pose_mae_dy": 0.045589279383420944,
      "pose_rmse_dtheta": 0.3919994533061981,
      "pose_rmse_dx": 0.2190011888742447,
      "pose_rmse_dy": 0.10543753206729889,
      "pose_rmse_mean": 0.23881272971630096,
      "rmse_dtheta": 0.04442837834358215,
      "rmse_dx": 0.024141399189829826,
      "rmse_dy": 0.006011167541146278,
      "rmse_mean": 0.024860315024852753,
      "rotation_flip": 0.01397949643433094,
      "sparse_tokens": 20722.0,
      "step": 4921,
      "turn_loss": 0.22649314999580383,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2286749674781639,
      "grad_norm": 0.7156495451927185,
      "learning_rate": 6.483339234735386e-06,
      "loss": 0.1379,
      "mae_dtheta": 0.012655691243708134,
      "mae_dx": 0.0018868711777031422,
      "mae_dy": 0.003999593202024698,
      "pose_mae_dtheta": 0.0922352522611618,
      "pose_mae_dx": 0.031659651547670364,
      "pose_mae_dy": 0.04327154904603958,
      "pose_rmse_dtheta": 0.21877744793891907,
      "pose_rmse_dx": 0.0799299106001854,
      "pose_rmse_dy": 0.12223010510206223,
      "pose_rmse_mean": 0.14031249284744263,
      "rmse_dtheta": 0.02478453703224659,
      "rmse_dx": 0.005011371336877346,
      "rmse_dy": 0.008521896786987782,
      "rmse_mean": 0.01277260109782219,
      "rotation_flip": 0.005941329523921013,
      "sparse_tokens": 32057.0,
      "step": 4922,
      "turn_loss": 0.11220228672027588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.22872142724400668,
      "grad_norm": 1.00501549243927,
      "learning_rate": 6.482076489098687e-06,
      "loss": 0.2362,
      "mae_dtheta": 0.031036322936415672,
      "mae_dx": 0.009989147074520588,
      "mae_dy": 0.003671655897051096,
      "pose_mae_dtheta": 0.2490667998790741,
      "pose_mae_dx": 0.08193846791982651,
      "pose_mae_dy": 0.045769717544317245,
      "pose_rmse_dtheta": 0.4735814034938812,
      "pose_rmse_dx": 0.19788041710853577,
      "pose_rmse_dy": 0.11631685495376587,
      "pose_rmse_mean": 0.2625929117202759,
      "rmse_dtheta": 0.05008867755532265,
      "rmse_dx": 0.02241215668618679,
      "rmse_dy": 0.008707509376108646,
      "rmse_mean": 0.027069447562098503,
      "rotation_flip": 0.015065913088619709,
      "sparse_tokens": 17957.0,
      "step": 4923,
      "turn_loss": 0.2032608687877655,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 17537.0,
      "epoch": 0.22876788700984946,
      "grad_norm": 0.550335168838501,
      "learning_rate": 6.480813639819583e-06,
      "loss": 0.1677,
      "mae_dtheta": 0.043074559420347214,
      "mae_dx": 0.011350210756063461,
      "mae_dy": 0.003976850770413876,
      "pose_mae_dtheta": 0.3345552980899811,
      "pose_mae_dx": 0.09354032576084137,
      "pose_mae_dy": 0.03673103079199791,
      "pose_rmse_dtheta": 0.5684410333633423,
      "pose_rmse_dx": 0.21895372867584229,
      "pose_rmse_dy": 0.09237968176603317,
      "pose_rmse_mean": 0.2932581603527069,
      "rmse_dtheta": 0.06111474335193634,
      "rmse_dx": 0.024208983406424522,
      "rmse_dy": 0.009452370926737785,
      "rmse_mean": 0.03159203380346298,
      "rotation_flip": 0.0219058059155941,
      "sparse_tokens": 12934.0,
      "step": 4924,
      "turn_loss": 0.2966119945049286,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.22881434677569226,
      "grad_norm": 0.8741826415061951,
      "learning_rate": 6.479550686986387e-06,
      "loss": 0.1148,
      "mae_dtheta": 0.010679173283278942,
      "mae_dx": 0.0019272834761068225,
      "mae_dy": 0.002100953133776784,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8741824626922607,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.81446838378906,
      "model/head/act_norm_mean": 126.4344026199495,
      "model/head/act_norm_min": 62.77849197387695,
      "model/head/act_over_embed": 86.88690517795608,
      "model/head/grad_frac": 0.07299260050058365,
      "model/head/grad_norm": 0.0638088509440422,
      "model/head/grad_zero_frac": 0.00014784865197725594,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.689813170770202,
      "model/head/update_ratio": 0.0010932025033980608,
      "model/head/weight_delta": 8.23713207244873,
      "model/head/weight_delta_rel": 0.14450369775295258,
      "model/head/weight_norm": 58.368736267089844,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4196178615093231,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.419558129456366,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4194842576980591,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2883242745275088,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08591003715991974,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07510104775428772,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5382778384279476,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0024296462070196867,
      "model/modality_embedder.encoders.pose/weight_delta": 2.694175958633423,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08802712708711624,
      "model/modality_embedder.encoders.pose/weight_norm": 30.910280227661133,
      "model/modality_embedder/grad_frac": 0.08591003715991974,
      "model/modality_embedder/grad_norm": 0.07510104775428772,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5382778384279476,
      "model/modality_embedder/update_ratio": 0.0024296462070196867,
      "model/modality_embedder/weight_delta": 2.694175958633423,
      "model/modality_embedder/weight_delta_rel": 0.08802712708711624,
      "model/modality_embedder/weight_norm": 30.910280227661133,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.81080627441406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.202691598524932,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.061999320983887,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.319525617822553,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.051035016775131226,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04461391642689705,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016045772936195135,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.019890785217285,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07360603660345078,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.804155349731445,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.05449676513672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.249043009459676,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.378660202026367,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.038588103513156,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05320582538843155,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04651159793138504,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001575904549099505,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.559330463409424,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0886572077870369,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.514223098754883,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.78870391845703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.187184343434343,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.549589157104492,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.3704969733856,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06387239694595337,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05583612620830536,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001832533162087202,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.7526755332946777,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09242969006299973,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.46936798095703,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.58838653564453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.96157257094757,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.211503982543945,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.589873175417004,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07655385881662369,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06692203879356384,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022493351716548204,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.3464367389678955,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08019006997346878,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.75191879272461,
      "model/normalizer/grad_frac": 0.2917279601097107,
      "model/normalizer/grad_norm": 0.2550234794616699,
      "model/normalizer/grad_zero_frac": 0.00023043899273034185,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0032541106920689344,
      "model/normalizer/weight_delta": 4.983277797698975,
      "model/normalizer/weight_delta_rel": 0.06418173015117645,
      "model/normalizer/weight_norm": 78.36963653564453,
      "pose_mae_dtheta": 0.08056580275297165,
      "pose_mae_dx": 0.02288156747817993,
      "pose_mae_dy": 0.02744586020708084,
      "pose_rmse_dtheta": 0.24169579148292542,
      "pose_rmse_dx": 0.05444512516260147,
      "pose_rmse_dy": 0.08462214469909668,
      "pose_rmse_mean": 0.12692102789878845,
      "rmse_dtheta": 0.02797026000916958,
      "rmse_dx": 0.005314459092915058,
      "rmse_dy": 0.005993965081870556,
      "rmse_mean": 0.013092895969748497,
      "rotation_flip": 0.0036680421326309443,
      "sparse_tokens": 32153.0,
      "step": 4925,
      "turn_loss": 0.0865425318479538,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22886080654153504,
      "grad_norm": 0.6360955238342285,
      "learning_rate": 6.478287630687418e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.008765537291765213,
      "mae_dx": 0.0017377722542732954,
      "mae_dy": 0.0017202419694513083,
      "pose_mae_dtheta": 0.05840809643268585,
      "pose_mae_dx": 0.015314500778913498,
      "pose_mae_dy": 0.020603373646736145,
      "pose_rmse_dtheta": 0.15905220806598663,
      "pose_rmse_dx": 0.04615115746855736,
      "pose_rmse_dy": 0.049324341118335724,
      "pose_rmse_mean": 0.08484257757663727,
      "rmse_dtheta": 0.02141605131328106,
      "rmse_dx": 0.005878695752471685,
      "rmse_dy": 0.004551197402179241,
      "rmse_mean": 0.010615315288305283,
      "rotation_flip": 0.0050973123870790005,
      "sparse_tokens": 32105.0,
      "step": 4926,
      "turn_loss": 0.0778968334197998,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.22890726630737782,
      "grad_norm": 0.49988770484924316,
      "learning_rate": 6.477024471011001e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.010059243999421597,
      "mae_dx": 0.0013526545371860266,
      "mae_dy": 0.002337866695597768,
      "pose_mae_dtheta": 0.06445049494504929,
      "pose_mae_dx": 0.023113885894417763,
      "pose_mae_dy": 0.03196679800748825,
      "pose_rmse_dtheta": 0.13447168469429016,
      "pose_rmse_dx": 0.06793534010648727,
      "pose_rmse_dy": 0.07627600431442261,
      "pose_rmse_mean": 0.09289434552192688,
      "rmse_dtheta": 0.02033519372344017,
      "rmse_dx": 0.003731096163392067,
      "rmse_dy": 0.005528454668819904,
      "rmse_mean": 0.009864915162324905,
      "rotation_flip": 0.006677140481770039,
      "sparse_tokens": 32089.0,
      "step": 4927,
      "turn_loss": 0.09020411968231201,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2289537260732206,
      "grad_norm": 0.49304425716400146,
      "learning_rate": 6.47576120804547e-06,
      "loss": 0.133,
      "mae_dtheta": 0.00938066653907299,
      "mae_dx": 0.0015998840099200606,
      "mae_dy": 0.0024047873448580503,
      "pose_mae_dtheta": 0.06630785763263702,
      "pose_mae_dx": 0.0202643945813179,
      "pose_mae_dy": 0.02924421988427639,
      "pose_rmse_dtheta": 0.1781003326177597,
      "pose_rmse_dx": 0.04558412358164787,
      "pose_rmse_dy": 0.07024725526571274,
      "pose_rmse_mean": 0.09797724336385727,
      "rmse_dtheta": 0.02205953560769558,
      "rmse_dx": 0.005383127368986607,
      "rmse_dy": 0.005452666897326708,
      "rmse_mean": 0.01096511073410511,
      "rotation_flip": 0.006076718680560589,
      "sparse_tokens": 32089.0,
      "step": 4928,
      "turn_loss": 0.08047544211149216,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.22900018583906337,
      "grad_norm": 0.39403873682022095,
      "learning_rate": 6.474497841879166e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.01093987189233303,
      "mae_dx": 0.0014893964398652315,
      "mae_dy": 0.0026962615083903074,
      "pose_mae_dtheta": 0.07576458156108856,
      "pose_mae_dx": 0.02411726675927639,
      "pose_mae_dy": 0.03892095014452934,
      "pose_rmse_dtheta": 0.16975098848342896,
      "pose_rmse_dx": 0.061186812818050385,
      "pose_rmse_dy": 0.08740685135126114,
      "pose_rmse_mean": 0.10611488670110703,
      "rmse_dtheta": 0.020772336050868034,
      "rmse_dx": 0.004768005572259426,
      "rmse_dy": 0.005208577029407024,
      "rmse_mean": 0.010249639861285686,
      "rotation_flip": 0.00600375235080719,
      "sparse_tokens": 32089.0,
      "step": 4929,
      "turn_loss": 0.0864378809928894,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.22904664560490615,
      "grad_norm": 0.47753313183784485,
      "learning_rate": 6.473234372600436e-06,
      "loss": 0.1659,
      "mae_dtheta": 0.040105000138282776,
      "mae_dx": 0.013405977748334408,
      "mae_dy": 0.003417479107156396,
      "pose_mae_dtheta": 0.3413340151309967,
      "pose_mae_dx": 0.11690617352724075,
      "pose_mae_dy": 0.03793806955218315,
      "pose_rmse_dtheta": 0.5240968465805054,
      "pose_rmse_dx": 0.2508837878704071,
      "pose_rmse_dy": 0.08984522521495819,
      "pose_rmse_mean": 0.2882753014564514,
      "rmse_dtheta": 0.05543849244713783,
      "rmse_dx": 0.025306858122348785,
      "rmse_dy": 0.007465688977390528,
      "rmse_mean": 0.0294036827981472,
      "rotation_flip": 0.01325178425759077,
      "sparse_tokens": 15917.0,
      "step": 4930,
      "turn_loss": 0.28252342343330383,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22909310537074892,
      "grad_norm": 0.5726004242897034,
      "learning_rate": 6.4719708002976355e-06,
      "loss": 0.1285,
      "mae_dtheta": 0.008339198306202888,
      "mae_dx": 0.0029020814690738916,
      "mae_dy": 0.0029185479506850243,
      "pose_mae_dtheta": 0.05782034248113632,
      "pose_mae_dx": 0.032558590173721313,
      "pose_mae_dy": 0.024875223636627197,
      "pose_rmse_dtheta": 0.10876569151878357,
      "pose_rmse_dx": 0.08239945769309998,
      "pose_rmse_dy": 0.055193644016981125,
      "pose_rmse_mean": 0.08211959898471832,
      "rmse_dtheta": 0.01774626597762108,
      "rmse_dx": 0.0075822314247488976,
      "rmse_dy": 0.006909121759235859,
      "rmse_mean": 0.010745873674750328,
      "rotation_flip": 0.0013850415125489235,
      "sparse_tokens": 32105.0,
      "step": 4931,
      "turn_loss": 0.1109173521399498,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2291395651365917,
      "grad_norm": 0.5224423408508301,
      "learning_rate": 6.470707125059128e-06,
      "loss": 0.0733,
      "mae_dtheta": 0.008516054600477219,
      "mae_dx": 0.0012707251589745283,
      "mae_dy": 0.0018554446287453175,
      "pose_mae_dtheta": 0.057087015360593796,
      "pose_mae_dx": 0.016605213284492493,
      "pose_mae_dy": 0.024784190580248833,
      "pose_rmse_dtheta": 0.1625727117061615,
      "pose_rmse_dx": 0.04466662183403969,
      "pose_rmse_dy": 0.0605839267373085,
      "pose_rmse_mean": 0.08927442133426666,
      "rmse_dtheta": 0.01906542293727398,
      "rmse_dx": 0.004123428836464882,
      "rmse_dy": 0.003654065541923046,
      "rmse_mean": 0.008947639726102352,
      "rotation_flip": 0.0018463811138644814,
      "sparse_tokens": 32089.0,
      "step": 4932,
      "turn_loss": 0.06859803199768066,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.2291860249024345,
      "grad_norm": 0.4127018451690674,
      "learning_rate": 6.469443346973281e-06,
      "loss": 0.1103,
      "mae_dtheta": 0.026706496253609657,
      "mae_dx": 0.007563792169094086,
      "mae_dy": 0.005905784200876951,
      "pose_mae_dtheta": 0.18297545611858368,
      "pose_mae_dx": 0.06914687156677246,
      "pose_mae_dy": 0.06946234405040741,
      "pose_rmse_dtheta": 0.32943081855773926,
      "pose_rmse_dx": 0.1549035757780075,
      "pose_rmse_dy": 0.1490022838115692,
      "pose_rmse_mean": 0.21111223101615906,
      "rmse_dtheta": 0.04144188389182091,
      "rmse_dx": 0.01807122863829136,
      "rmse_dy": 0.00989268533885479,
      "rmse_mean": 0.023135267198085785,
      "rotation_flip": 0.02478134073317051,
      "sparse_tokens": 12755.0,
      "step": 4933,
      "turn_loss": 0.18478527665138245,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.22923248466827728,
      "grad_norm": 0.6506928205490112,
      "learning_rate": 6.468179466128473e-06,
      "loss": 0.1321,
      "mae_dtheta": 0.00905279815196991,
      "mae_dx": 0.002198141301050782,
      "mae_dy": 0.001348785008303821,
      "pose_mae_dtheta": 0.06294400244951248,
      "pose_mae_dx": 0.020159820094704628,
      "pose_mae_dy": 0.017940180376172066,
      "pose_rmse_dtheta": 0.1682361215353012,
      "pose_rmse_dx": 0.05011564865708351,
      "pose_rmse_dy": 0.053260523825883865,
      "pose_rmse_mean": 0.090537428855896,
      "rmse_dtheta": 0.02315465733408928,
      "rmse_dx": 0.006665552034974098,
      "rmse_dy": 0.0033719316124916077,
      "rmse_mean": 0.011064047925174236,
      "rotation_flip": 0.001983143389225006,
      "sparse_tokens": 32153.0,
      "step": 4934,
      "turn_loss": 0.08122953027486801,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.22927894443412006,
      "grad_norm": 0.5743414759635925,
      "learning_rate": 6.466915482613086e-06,
      "loss": 0.1244,
      "mae_dtheta": 0.012120583094656467,
      "mae_dx": 0.0016918261535465717,
      "mae_dy": 0.0029035289771854877,
      "pose_mae_dtheta": 0.0831073597073555,
      "pose_mae_dx": 0.026164967566728592,
      "pose_mae_dy": 0.034689947962760925,
      "pose_rmse_dtheta": 0.2080313116312027,
      "pose_rmse_dx": 0.05965263769030571,
      "pose_rmse_dy": 0.07318094372749329,
      "pose_rmse_mean": 0.11362163722515106,
      "rmse_dtheta": 0.025205561891198158,
      "rmse_dx": 0.00515085319057107,
      "rmse_dy": 0.006053948309272528,
      "rmse_mean": 0.012136787176132202,
      "rotation_flip": 0.005426917690783739,
      "sparse_tokens": 32105.0,
      "step": 4935,
      "turn_loss": 0.09500936418771744,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32986.0,
      "epoch": 0.22932540419996283,
      "grad_norm": 0.6240059733390808,
      "learning_rate": 6.465651396515511e-06,
      "loss": 0.1636,
      "mae_dtheta": 0.02957964316010475,
      "mae_dx": 0.010842348448932171,
      "mae_dy": 0.005005672574043274,
      "pose_mae_dtheta": 0.22529835999011993,
      "pose_mae_dx": 0.09197845309972763,
      "pose_mae_dy": 0.06675788760185242,
      "pose_rmse_dtheta": 0.40366658568382263,
      "pose_rmse_dx": 0.20841246843338013,
      "pose_rmse_dy": 0.15639182925224304,
      "pose_rmse_mean": 0.2561569809913635,
      "rmse_dtheta": 0.045463886111974716,
      "rmse_dx": 0.023091403767466545,
      "rmse_dy": 0.010376681573688984,
      "rmse_mean": 0.02631065808236599,
      "rotation_flip": 0.012204424478113651,
      "sparse_tokens": 26555.0,
      "step": 4936,
      "turn_loss": 0.24742527306079865,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.2293718639658056,
      "grad_norm": 0.6761999726295471,
      "learning_rate": 6.464387207924148e-06,
      "loss": 0.1165,
      "mae_dtheta": 0.027086006477475166,
      "mae_dx": 0.007060951553285122,
      "mae_dy": 0.002390057547017932,
      "pose_mae_dtheta": 0.21273204684257507,
      "pose_mae_dx": 0.05483892560005188,
      "pose_mae_dy": 0.0328962579369545,
      "pose_rmse_dtheta": 0.37929731607437134,
      "pose_rmse_dx": 0.1178736761212349,
      "pose_rmse_dy": 0.08282768726348877,
      "pose_rmse_mean": 0.19333289563655853,
      "rmse_dtheta": 0.04422890394926071,
      "rmse_dx": 0.016097571700811386,
      "rmse_dy": 0.0048501156270504,
      "rmse_mean": 0.021725531667470932,
      "rotation_flip": 0.021621622145175934,
      "sparse_tokens": 4254.0,
      "step": 4937,
      "turn_loss": 0.14153674244880676,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.2294183237316484,
      "grad_norm": 0.5190353989601135,
      "learning_rate": 6.463122916927401e-06,
      "loss": 0.1442,
      "mae_dtheta": 0.034178733825683594,
      "mae_dx": 0.01349389087408781,
      "mae_dy": 0.006164532620459795,
      "pose_mae_dtheta": 0.265513151884079,
      "pose_mae_dx": 0.10808519273996353,
      "pose_mae_dy": 0.07715243846178055,
      "pose_rmse_dtheta": 0.49782371520996094,
      "pose_rmse_dx": 0.2246234118938446,
      "pose_rmse_dy": 0.15073972940444946,
      "pose_rmse_mean": 0.29106229543685913,
      "rmse_dtheta": 0.05362357944250107,
      "rmse_dx": 0.026781052350997925,
      "rmse_dy": 0.010759878903627396,
      "rmse_mean": 0.03038817271590233,
      "rotation_flip": 0.01263537909835577,
      "sparse_tokens": 9962.0,
      "step": 4938,
      "turn_loss": 0.2813708782196045,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.22946478349749116,
      "grad_norm": 0.5135320425033569,
      "learning_rate": 6.461858523613684e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.0333266519010067,
      "mae_dx": 0.01587967574596405,
      "mae_dy": 0.003008846426382661,
      "pose_mae_dtheta": 0.2931770980358124,
      "pose_mae_dx": 0.12309490889310837,
      "pose_mae_dy": 0.045755237340927124,
      "pose_rmse_dtheta": 0.5403233766555786,
      "pose_rmse_dx": 0.2778947651386261,
      "pose_rmse_dy": 0.09379316866397858,
      "pose_rmse_mean": 0.3040037751197815,
      "rmse_dtheta": 0.05423536151647568,
      "rmse_dx": 0.0297398641705513,
      "rmse_dy": 0.005775186233222485,
      "rmse_mean": 0.029916804283857346,
      "rotation_flip": 0.014084506779909134,
      "sparse_tokens": 6755.0,
      "step": 4939,
      "turn_loss": 0.27469709515571594,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.22951124326333394,
      "grad_norm": 0.5108550190925598,
      "learning_rate": 6.460594028071416e-06,
      "loss": 0.1307,
      "mae_dtheta": 0.0135786272585392,
      "mae_dx": 0.002669201698154211,
      "mae_dy": 0.0027367298025637865,
      "pose_mae_dtheta": 0.09692534804344177,
      "pose_mae_dx": 0.02579624019563198,
      "pose_mae_dy": 0.026726849377155304,
      "pose_rmse_dtheta": 0.27105456590652466,
      "pose_rmse_dx": 0.07696901261806488,
      "pose_rmse_dy": 0.06127578765153885,
      "pose_rmse_mean": 0.13643312454223633,
      "rmse_dtheta": 0.032489653676748276,
      "rmse_dx": 0.007975091226398945,
      "rmse_dy": 0.00742134265601635,
      "rmse_mean": 0.015962030738592148,
      "rotation_flip": 0.0033319450449198484,
      "sparse_tokens": 32153.0,
      "step": 4940,
      "turn_loss": 0.11870640516281128,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.22955770302917675,
      "grad_norm": 0.48251646757125854,
      "learning_rate": 6.459329430389023e-06,
      "loss": 0.1331,
      "mae_dtheta": 0.01100899651646614,
      "mae_dx": 0.0014137353282421827,
      "mae_dy": 0.0018363845301792026,
      "pose_mae_dtheta": 0.07337649911642075,
      "pose_mae_dx": 0.018114155158400536,
      "pose_mae_dy": 0.023744521662592888,
      "pose_rmse_dtheta": 0.19478191435337067,
      "pose_rmse_dx": 0.047691963613033295,
      "pose_rmse_dy": 0.05521661415696144,
      "pose_rmse_mean": 0.09923016279935837,
      "rmse_dtheta": 0.023179147392511368,
      "rmse_dx": 0.00499701825901866,
      "rmse_dy": 0.0036807518918067217,
      "rmse_mean": 0.010618972592055798,
      "rotation_flip": 0.0037437602877616882,
      "sparse_tokens": 32057.0,
      "step": 4941,
      "turn_loss": 0.07794580608606339,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.22960416279501952,
      "grad_norm": 0.7017627358436584,
      "learning_rate": 6.45806473065494e-06,
      "loss": 0.1911,
      "mae_dtheta": 0.03209953010082245,
      "mae_dx": 0.011801016516983509,
      "mae_dy": 0.007504989393055439,
      "pose_mae_dtheta": 0.23885959386825562,
      "pose_mae_dx": 0.08327428996562958,
      "pose_mae_dy": 0.07309962809085846,
      "pose_rmse_dtheta": 0.397893488407135,
      "pose_rmse_dx": 0.2065882682800293,
      "pose_rmse_dy": 0.16162388026714325,
      "pose_rmse_mean": 0.25536856055259705,
      "rmse_dtheta": 0.04626907408237457,
      "rmse_dx": 0.023953523486852646,
      "rmse_dy": 0.01405042689293623,
      "rmse_mean": 0.028091009706258774,
      "rotation_flip": 0.012598425149917603,
      "sparse_tokens": 10658.0,
      "step": 4942,
      "turn_loss": 0.38457217812538147,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2296506225608623,
      "grad_norm": 0.4423963725566864,
      "learning_rate": 6.456799928957607e-06,
      "loss": 0.0924,
      "mae_dtheta": 0.00905080046504736,
      "mae_dx": 0.0018551318207755685,
      "mae_dy": 0.00205658539198339,
      "pose_mae_dtheta": 0.06010017171502113,
      "pose_mae_dx": 0.020787710323929787,
      "pose_mae_dy": 0.022817818447947502,
      "pose_rmse_dtheta": 0.15830156207084656,
      "pose_rmse_dx": 0.0480344220995903,
      "pose_rmse_dy": 0.05967773497104645,
      "pose_rmse_mean": 0.0886712521314621,
      "rmse_dtheta": 0.021442240104079247,
      "rmse_dx": 0.005125231109559536,
      "rmse_dy": 0.004552854225039482,
      "rmse_mean": 0.010373441502451897,
      "rotation_flip": 0.002184201031923294,
      "sparse_tokens": 32185.0,
      "step": 4943,
      "turn_loss": 0.08025497198104858,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.22969708232670508,
      "grad_norm": 0.4756139814853668,
      "learning_rate": 6.455535025385474e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.008193876594305038,
      "mae_dx": 0.001833040383644402,
      "mae_dy": 0.0007895204471424222,
      "pose_mae_dtheta": 0.05868839472532272,
      "pose_mae_dx": 0.015848519280552864,
      "pose_mae_dy": 0.010786090046167374,
      "pose_rmse_dtheta": 0.1897546947002411,
      "pose_rmse_dx": 0.04030093178153038,
      "pose_rmse_dy": 0.0316774956882,
      "pose_rmse_mean": 0.08724437654018402,
      "rmse_dtheta": 0.02472664602100849,
      "rmse_dx": 0.005611200351268053,
      "rmse_dy": 0.002109419321641326,
      "rmse_mean": 0.010815754532814026,
      "rotation_flip": 0.0028873917181044817,
      "sparse_tokens": 32201.0,
      "step": 4944,
      "turn_loss": 0.04742124304175377,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.22974354209254785,
      "grad_norm": 0.41253092885017395,
      "learning_rate": 6.454270020026996e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.010331181809306145,
      "mae_dx": 0.0015700031071901321,
      "mae_dy": 0.002957371063530445,
      "pose_mae_dtheta": 0.07249262183904648,
      "pose_mae_dx": 0.020424015820026398,
      "pose_mae_dy": 0.030330482870340347,
      "pose_rmse_dtheta": 0.1500224471092224,
      "pose_rmse_dx": 0.0613403357565403,
      "pose_rmse_dy": 0.06642267107963562,
      "pose_rmse_mean": 0.09259515255689621,
      "rmse_dtheta": 0.02007325552403927,
      "rmse_dx": 0.005130545236170292,
      "rmse_dy": 0.006639777682721615,
      "rmse_mean": 0.010614527389407158,
      "rotation_flip": 0.0030959751456975937,
      "sparse_tokens": 32041.0,
      "step": 4945,
      "turn_loss": 0.08547430485486984,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.22979000185839063,
      "grad_norm": 0.5890691876411438,
      "learning_rate": 6.4530049129706344e-06,
      "loss": 0.1692,
      "mae_dtheta": 0.009293889626860619,
      "mae_dx": 0.00153169350232929,
      "mae_dy": 0.0023980436380952597,
      "pose_mae_dtheta": 0.05702115222811699,
      "pose_mae_dx": 0.016296319663524628,
      "pose_mae_dy": 0.02678861655294895,
      "pose_rmse_dtheta": 0.10847749561071396,
      "pose_rmse_dx": 0.0356004573404789,
      "pose_rmse_dy": 0.062013767659664154,
      "pose_rmse_mean": 0.0686972439289093,
      "rmse_dtheta": 0.019345343112945557,
      "rmse_dx": 0.004066523164510727,
      "rmse_dy": 0.00556508032605052,
      "rmse_mean": 0.00965898297727108,
      "rotation_flip": 0.010545454919338226,
      "sparse_tokens": 32121.0,
      "step": 4946,
      "turn_loss": 0.08691757172346115,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.2298364616242334,
      "grad_norm": 0.35898759961128235,
      "learning_rate": 6.4517397043048595e-06,
      "loss": 0.0756,
      "mae_dtheta": 0.028158001601696014,
      "mae_dx": 0.013347321189939976,
      "mae_dy": 0.01246272586286068,
      "pose_mae_dtheta": 0.21233275532722473,
      "pose_mae_dx": 0.1241346076130867,
      "pose_mae_dy": 0.1262393593788147,
      "pose_rmse_dtheta": 0.4279573857784271,
      "pose_rmse_dx": 0.25784987211227417,
      "pose_rmse_dy": 0.261954128742218,
      "pose_rmse_mean": 0.31592047214508057,
      "rmse_dtheta": 0.05036817118525505,
      "rmse_dx": 0.02526235394179821,
      "rmse_dy": 0.024719305336475372,
      "rmse_mean": 0.033449944108724594,
      "rotation_flip": 0.021276595070958138,
      "sparse_tokens": 5017.0,
      "step": 4947,
      "turn_loss": 0.37736114859580994,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.22988292139007618,
      "grad_norm": 0.5750253796577454,
      "learning_rate": 6.450474394118147e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.027823960408568382,
      "mae_dx": 0.006704720202833414,
      "mae_dy": 0.005682262592017651,
      "pose_mae_dtheta": 0.2300666868686676,
      "pose_mae_dx": 0.05637172982096672,
      "pose_mae_dy": 0.05421384796500206,
      "pose_rmse_dtheta": 0.4057309329509735,
      "pose_rmse_dx": 0.12522539496421814,
      "pose_rmse_dy": 0.11424876749515533,
      "pose_rmse_mean": 0.21506837010383606,
      "rmse_dtheta": 0.04453384131193161,
      "rmse_dx": 0.015070091933012009,
      "rmse_dy": 0.011209851130843163,
      "rmse_mean": 0.02360459417104721,
      "rotation_flip": 0.006012023892253637,
      "sparse_tokens": 8338.0,
      "step": 4948,
      "turn_loss": 0.22023963928222656,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.22992938115591896,
      "grad_norm": 0.48932889103889465,
      "learning_rate": 6.449208982498983e-06,
      "loss": 0.0844,
      "mae_dtheta": 0.008980996906757355,
      "mae_dx": 0.0015720009105280042,
      "mae_dy": 0.0017385657411068678,
      "pose_mae_dtheta": 0.05593974515795708,
      "pose_mae_dx": 0.019977858290076256,
      "pose_mae_dy": 0.01939554326236248,
      "pose_rmse_dtheta": 0.16652406752109528,
      "pose_rmse_dx": 0.05380243435502052,
      "pose_rmse_dy": 0.04772784560918808,
      "pose_rmse_mean": 0.08935144543647766,
      "rmse_dtheta": 0.02370106801390648,
      "rmse_dx": 0.004551968537271023,
      "rmse_dy": 0.00419667549431324,
      "rmse_mean": 0.010816572234034538,
      "rotation_flip": 0.00249272957444191,
      "sparse_tokens": 32137.0,
      "step": 4949,
      "turn_loss": 0.06561843305826187,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27254.0,
      "epoch": 0.22997584092176176,
      "grad_norm": 0.5774735808372498,
      "learning_rate": 6.447943469535856e-06,
      "loss": 0.1551,
      "mae_dtheta": 0.0367615707218647,
      "mae_dx": 0.014225885272026062,
      "mae_dy": 0.006295712664723396,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.577473521232605,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.46763610839844,
      "model/head/act_norm_mean": 100.81640625,
      "model/head/act_norm_min": 65.2352294921875,
      "model/head/act_over_embed": 69.28197823306604,
      "model/head/grad_frac": 0.10744762420654297,
      "model/head/grad_norm": 0.062048159539699554,
      "model/head/grad_zero_frac": 0.00016149133443832397,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6833263578869048,
      "model/head/update_ratio": 0.0010629594326019287,
      "model/head/weight_delta": 8.25774097442627,
      "model/head/weight_delta_rel": 0.1448652297258377,
      "model/head/weight_norm": 58.373023986816406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41967958211898804,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41962203979492185,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41955822706222534,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28836819431050237,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06745027750730515,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03895074874162674,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5263327205882353,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001260095159523189,
      "model/modality_embedder.encoders.pose/weight_delta": 2.7014217376708984,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0882638692855835,
      "model/modality_embedder.encoders.pose/weight_norm": 30.91095733642578,
      "model/modality_embedder/grad_frac": 0.06745027750730515,
      "model/modality_embedder/grad_norm": 0.03895074874162674,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5263327205882353,
      "model/modality_embedder/update_ratio": 0.001260095159523189,
      "model/modality_embedder/weight_delta": 2.7014217376708984,
      "model/modality_embedder/weight_delta_rel": 0.0882638692855835,
      "model/modality_embedder/weight_norm": 30.91095733642578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.49443054199219,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.736993929516252,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.325165748596191,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.625075095454513,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0833161473274231,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04811286926269531,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017302908236160874,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.0263538360595703,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07384155690670013,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.806232452392578,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.9330062866211,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.572197715891914,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.885467529296875,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.19903495675291,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08631810545921326,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04984642192721367,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016887399833649397,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.5674538612365723,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08893860876560211,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.516931533813477,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.8149185180664,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.201893778344672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.156984329223633,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.31897734832537,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0921916738152504,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05323825031518936,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001747146132402122,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.76082444190979,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09270331263542175,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.47154998779297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.62174224853516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.145476072373395,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.905139923095703,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.654625296886028,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10105755180120468,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05835805833339691,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019613595213741064,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.3551888465881348,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08048918098211288,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.75387954711914,
      "model/normalizer/grad_frac": 0.406227171421051,
      "model/normalizer/grad_norm": 0.23458543419837952,
      "model/normalizer/grad_zero_frac": 0.00020207726629450917,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0029932099860161543,
      "model/normalizer/weight_delta": 4.999391078948975,
      "model/normalizer/weight_delta_rel": 0.06438926607370377,
      "model/normalizer/weight_norm": 78.37252807617188,
      "pose_mae_dtheta": 0.2937770187854767,
      "pose_mae_dx": 0.12010464072227478,
      "pose_mae_dy": 0.06446050852537155,
      "pose_rmse_dtheta": 0.49469828605651855,
      "pose_rmse_dx": 0.2440289855003357,
      "pose_rmse_dy": 0.13843487203121185,
      "pose_rmse_mean": 0.2923873960971832,
      "rmse_dtheta": 0.05247175693511963,
      "rmse_dx": 0.026739267632365227,
      "rmse_dy": 0.013703727163374424,
      "rmse_mean": 0.030971584841609,
      "rotation_flip": 0.01011804398149252,
      "sparse_tokens": 20813.0,
      "step": 4950,
      "turn_loss": 0.3543703556060791,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.23002230068760454,
      "grad_norm": 0.5298307538032532,
      "learning_rate": 6.446677855317265e-06,
      "loss": 0.1087,
      "mae_dtheta": 0.013721374794840813,
      "mae_dx": 0.0022896919399499893,
      "mae_dy": 0.0035523821134120226,
      "pose_mae_dtheta": 0.09419632703065872,
      "pose_mae_dx": 0.03208056464791298,
      "pose_mae_dy": 0.041755784302949905,
      "pose_rmse_dtheta": 0.1990145593881607,
      "pose_rmse_dx": 0.08516929298639297,
      "pose_rmse_dy": 0.08865755796432495,
      "pose_rmse_mean": 0.12428047508001328,
      "rmse_dtheta": 0.02583802118897438,
      "rmse_dx": 0.007233239710330963,
      "rmse_dy": 0.00800606980919838,
      "rmse_mean": 0.013692444190382957,
      "rotation_flip": 0.007493443321436644,
      "sparse_tokens": 32057.0,
      "step": 4951,
      "turn_loss": 0.11857818812131882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.23006876045344732,
      "grad_norm": 0.49975576996803284,
      "learning_rate": 6.4454121399317145e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.030191877856850624,
      "mae_dx": 0.011679118499159813,
      "mae_dy": 0.0029286248609423637,
      "pose_mae_dtheta": 0.23004736006259918,
      "pose_mae_dx": 0.0950893759727478,
      "pose_mae_dy": 0.02529524452984333,
      "pose_rmse_dtheta": 0.41018080711364746,
      "pose_rmse_dx": 0.20968161523342133,
      "pose_rmse_dy": 0.056873440742492676,
      "pose_rmse_mean": 0.22557863593101501,
      "rmse_dtheta": 0.04751509800553322,
      "rmse_dx": 0.023563748225569725,
      "rmse_dy": 0.006774228066205978,
      "rmse_mean": 0.025951024144887924,
      "rotation_flip": 0.014447884634137154,
      "sparse_tokens": 15479.0,
      "step": 4952,
      "turn_loss": 0.258452832698822,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2301152202192901,
      "grad_norm": 0.7653372883796692,
      "learning_rate": 6.444146323467719e-06,
      "loss": 0.1778,
      "mae_dtheta": 0.013916220515966415,
      "mae_dx": 0.0026427856646478176,
      "mae_dy": 0.003534996183589101,
      "pose_mae_dtheta": 0.09526211768388748,
      "pose_mae_dx": 0.030390312895178795,
      "pose_mae_dy": 0.03495703637599945,
      "pose_rmse_dtheta": 0.2365722805261612,
      "pose_rmse_dx": 0.09584753215312958,
      "pose_rmse_dy": 0.07809693366289139,
      "pose_rmse_mean": 0.1368389129638672,
      "rmse_dtheta": 0.02951967529952526,
      "rmse_dx": 0.009196959435939789,
      "rmse_dy": 0.010310658253729343,
      "rmse_mean": 0.01634243130683899,
      "rotation_flip": 0.007120253052562475,
      "sparse_tokens": 32073.0,
      "step": 4953,
      "turn_loss": 0.1274396777153015,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.23016167998513287,
      "grad_norm": 0.4480937719345093,
      "learning_rate": 6.442880406013795e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.0315433144569397,
      "mae_dx": 0.01253717951476574,
      "mae_dy": 0.004441531840711832,
      "pose_mae_dtheta": 0.2279452085494995,
      "pose_mae_dx": 0.08880667388439178,
      "pose_mae_dy": 0.052677664905786514,
      "pose_rmse_dtheta": 0.4456935524940491,
      "pose_rmse_dx": 0.18565131723880768,
      "pose_rmse_dy": 0.13389849662780762,
      "pose_rmse_mean": 0.2550811171531677,
      "rmse_dtheta": 0.051668960601091385,
      "rmse_dx": 0.025102779269218445,
      "rmse_dy": 0.008773855865001678,
      "rmse_mean": 0.028515197336673737,
      "rotation_flip": 0.006211180239915848,
      "sparse_tokens": 16421.0,
      "step": 4954,
      "turn_loss": 0.23434942960739136,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 21682.0,
      "epoch": 0.23020813975097565,
      "grad_norm": 0.5318008661270142,
      "learning_rate": 6.44161438765847e-06,
      "loss": 0.1479,
      "mae_dtheta": 0.039099130779504776,
      "mae_dx": 0.012185463681817055,
      "mae_dy": 0.0070977346040308475,
      "pose_mae_dtheta": 0.34355440735816956,
      "pose_mae_dx": 0.10035664588212967,
      "pose_mae_dy": 0.08774351328611374,
      "pose_rmse_dtheta": 0.5488059520721436,
      "pose_rmse_dx": 0.21409495174884796,
      "pose_rmse_dy": 0.2132282853126526,
      "pose_rmse_mean": 0.32537639141082764,
      "rmse_dtheta": 0.0563996396958828,
      "rmse_dx": 0.024838251993060112,
      "rmse_dy": 0.013754673302173615,
      "rmse_mean": 0.03166418895125389,
      "rotation_flip": 0.012229539453983307,
      "sparse_tokens": 17140.0,
      "step": 4955,
      "turn_loss": 0.3539820909500122,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.23025459951681843,
      "grad_norm": 0.3753458559513092,
      "learning_rate": 6.4403482684902755e-06,
      "loss": 0.1022,
      "mae_dtheta": 0.01110696792602539,
      "mae_dx": 0.0020352855790406466,
      "mae_dy": 0.002737628063187003,
      "pose_mae_dtheta": 0.0892706960439682,
      "pose_mae_dx": 0.028008759021759033,
      "pose_mae_dy": 0.03149685636162758,
      "pose_rmse_dtheta": 0.2628965675830841,
      "pose_rmse_dx": 0.07693717628717422,
      "pose_rmse_dy": 0.088554248213768,
      "pose_rmse_mean": 0.14279600977897644,
      "rmse_dtheta": 0.02790853939950466,
      "rmse_dx": 0.005533822812139988,
      "rmse_dy": 0.006702554877847433,
      "rmse_mean": 0.013381639495491982,
      "rotation_flip": 0.003507233690470457,
      "sparse_tokens": 32073.0,
      "step": 4956,
      "turn_loss": 0.07500868290662766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.2303010592826612,
      "grad_norm": 0.49971067905426025,
      "learning_rate": 6.439082048597755e-06,
      "loss": 0.1137,
      "mae_dtheta": 0.05144724249839783,
      "mae_dx": 0.01911480352282524,
      "mae_dy": 0.011914976872503757,
      "pose_mae_dtheta": 0.372201144695282,
      "pose_mae_dx": 0.15780438482761383,
      "pose_mae_dy": 0.12636172771453857,
      "pose_rmse_dtheta": 0.5571591258049011,
      "pose_rmse_dx": 0.2729804217815399,
      "pose_rmse_dy": 0.23401683568954468,
      "pose_rmse_mean": 0.35471877455711365,
      "rmse_dtheta": 0.063837930560112,
      "rmse_dx": 0.0322965644299984,
      "rmse_dy": 0.018223846331238747,
      "rmse_mean": 0.03811945021152496,
      "rotation_flip": 0.027027027681469917,
      "sparse_tokens": 3908.0,
      "step": 4957,
      "turn_loss": 0.48183098435401917,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.230347519048504,
      "grad_norm": 0.4408605098724365,
      "learning_rate": 6.437815728069454e-06,
      "loss": 0.0972,
      "mae_dtheta": 0.03168445825576782,
      "mae_dx": 0.009721939451992512,
      "mae_dy": 0.004925165791064501,
      "pose_mae_dtheta": 0.20842903852462769,
      "pose_mae_dx": 0.08302799612283707,
      "pose_mae_dy": 0.05559185892343521,
      "pose_rmse_dtheta": 0.3636055290699005,
      "pose_rmse_dx": 0.2020268589258194,
      "pose_rmse_dy": 0.11997566372156143,
      "pose_rmse_mean": 0.22853603959083557,
      "rmse_dtheta": 0.04674365743994713,
      "rmse_dx": 0.021371252834796906,
      "rmse_dy": 0.009274895302951336,
      "rmse_mean": 0.025796599686145782,
      "rotation_flip": 0.014388489536941051,
      "sparse_tokens": 10000.0,
      "step": 4958,
      "turn_loss": 0.2406727522611618,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.23039397881434678,
      "grad_norm": 0.5848096609115601,
      "learning_rate": 6.436549306993929e-06,
      "loss": 0.1603,
      "mae_dtheta": 0.041860222816467285,
      "mae_dx": 0.01260911114513874,
      "mae_dy": 0.007648263592272997,
      "pose_mae_dtheta": 0.3530198037624359,
      "pose_mae_dx": 0.08177217841148376,
      "pose_mae_dy": 0.0888490229845047,
      "pose_rmse_dtheta": 0.55586838722229,
      "pose_rmse_dx": 0.1904774308204651,
      "pose_rmse_dy": 0.23799043893814087,
      "pose_rmse_mean": 0.32811209559440613,
      "rmse_dtheta": 0.05824077129364014,
      "rmse_dx": 0.024422351270914078,
      "rmse_dy": 0.01755695976316929,
      "rmse_mean": 0.03340669348835945,
      "rotation_flip": 0.009983360767364502,
      "sparse_tokens": 9847.0,
      "step": 4959,
      "turn_loss": 0.38382020592689514,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23044043858018956,
      "grad_norm": 0.5393358469009399,
      "learning_rate": 6.435282785459738e-06,
      "loss": 0.154,
      "mae_dtheta": 0.00973414070904255,
      "mae_dx": 0.0020685961935669184,
      "mae_dy": 0.0018573233392089605,
      "pose_mae_dtheta": 0.06285429745912552,
      "pose_mae_dx": 0.022069500759243965,
      "pose_mae_dy": 0.025883162394165993,
      "pose_rmse_dtheta": 0.14822377264499664,
      "pose_rmse_dx": 0.05055016651749611,
      "pose_rmse_dy": 0.0512724369764328,
      "pose_rmse_mean": 0.08334879577159882,
      "rmse_dtheta": 0.02149152010679245,
      "rmse_dx": 0.0065091559663414955,
      "rmse_dy": 0.003474152646958828,
      "rmse_mean": 0.010491609573364258,
      "rotation_flip": 0.005058365873992443,
      "sparse_tokens": 32089.0,
      "step": 4960,
      "turn_loss": 0.08511323481798172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.23048689834603234,
      "grad_norm": 0.5409639477729797,
      "learning_rate": 6.434016163555452e-06,
      "loss": 0.1148,
      "mae_dtheta": 0.034145206212997437,
      "mae_dx": 0.008653913624584675,
      "mae_dy": 0.009437639266252518,
      "pose_mae_dtheta": 0.22214746475219727,
      "pose_mae_dx": 0.09086321294307709,
      "pose_mae_dy": 0.12765364348888397,
      "pose_rmse_dtheta": 0.30719709396362305,
      "pose_rmse_dx": 0.2019205093383789,
      "pose_rmse_dy": 0.19910204410552979,
      "pose_rmse_mean": 0.23607322573661804,
      "rmse_dtheta": 0.046104345470666885,
      "rmse_dx": 0.02165292017161846,
      "rmse_dy": 0.012910552322864532,
      "rmse_mean": 0.026889272034168243,
      "rotation_flip": 0.020338982343673706,
      "sparse_tokens": 5243.0,
      "step": 4961,
      "turn_loss": 0.3720788359642029,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.23053335811187511,
      "grad_norm": 0.5883064270019531,
      "learning_rate": 6.4327494413696455e-06,
      "loss": 0.2067,
      "mae_dtheta": 0.042417846620082855,
      "mae_dx": 0.01021596509963274,
      "mae_dy": 0.005048937629908323,
      "pose_mae_dtheta": 0.3407679796218872,
      "pose_mae_dx": 0.09271785616874695,
      "pose_mae_dy": 0.04479961842298508,
      "pose_rmse_dtheta": 0.5787824988365173,
      "pose_rmse_dx": 0.21218466758728027,
      "pose_rmse_dy": 0.0995461717247963,
      "pose_rmse_mean": 0.29683780670166016,
      "rmse_dtheta": 0.06023401767015457,
      "rmse_dx": 0.021344872191548347,
      "rmse_dy": 0.010938740335404873,
      "rmse_mean": 0.030839210376143456,
      "rotation_flip": 0.009685230441391468,
      "sparse_tokens": 13609.0,
      "step": 4962,
      "turn_loss": 0.3092353940010071,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2305798178777179,
      "grad_norm": 0.5001230835914612,
      "learning_rate": 6.431482618990902e-06,
      "loss": 0.1179,
      "mae_dtheta": 0.014510317705571651,
      "mae_dx": 0.002114837756380439,
      "mae_dy": 0.0036260599736124277,
      "pose_mae_dtheta": 0.10181492567062378,
      "pose_mae_dx": 0.02749723196029663,
      "pose_mae_dy": 0.03738533705472946,
      "pose_rmse_dtheta": 0.24749207496643066,
      "pose_rmse_dx": 0.06798086315393448,
      "pose_rmse_dy": 0.08617006242275238,
      "pose_rmse_mean": 0.13388100266456604,
      "rmse_dtheta": 0.02979028783738613,
      "rmse_dx": 0.005444613751024008,
      "rmse_dy": 0.007802510168403387,
      "rmse_mean": 0.0143458042293787,
      "rotation_flip": 0.004617160651832819,
      "sparse_tokens": 32089.0,
      "step": 4963,
      "turn_loss": 0.11437971144914627,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.23062627764356067,
      "grad_norm": 0.4866688847541809,
      "learning_rate": 6.430215696507811e-06,
      "loss": 0.087,
      "mae_dtheta": 0.007437384687364101,
      "mae_dx": 0.0013795045670121908,
      "mae_dy": 0.001086534932255745,
      "pose_mae_dtheta": 0.05555910989642143,
      "pose_mae_dx": 0.013339432887732983,
      "pose_mae_dy": 0.018191993236541748,
      "pose_rmse_dtheta": 0.16575589776039124,
      "pose_rmse_dx": 0.04076867923140526,
      "pose_rmse_dy": 0.04204557463526726,
      "pose_rmse_mean": 0.08285672217607498,
      "rmse_dtheta": 0.021301008760929108,
      "rmse_dx": 0.005047485698014498,
      "rmse_dy": 0.0022225570864975452,
      "rmse_mean": 0.009523684158921242,
      "rotation_flip": 0.0026925147976726294,
      "sparse_tokens": 32073.0,
      "step": 4964,
      "turn_loss": 0.05542725324630737,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.23067273740940344,
      "grad_norm": 0.5159934759140015,
      "learning_rate": 6.428948674008968e-06,
      "loss": 0.1666,
      "mae_dtheta": 0.02887767367064953,
      "mae_dx": 0.013460911810398102,
      "mae_dy": 0.005984528921544552,
      "pose_mae_dtheta": 0.22354210913181305,
      "pose_mae_dx": 0.1005963534116745,
      "pose_mae_dy": 0.09279885143041611,
      "pose_rmse_dtheta": 0.34658336639404297,
      "pose_rmse_dx": 0.2442813366651535,
      "pose_rmse_dy": 0.1754651665687561,
      "pose_rmse_mean": 0.2554433047771454,
      "rmse_dtheta": 0.0417296476662159,
      "rmse_dx": 0.02849787101149559,
      "rmse_dy": 0.009309887886047363,
      "rmse_mean": 0.026512470096349716,
      "rotation_flip": 0.01652892492711544,
      "sparse_tokens": 7610.0,
      "step": 4965,
      "turn_loss": 0.23480954766273499,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23071919717524625,
      "grad_norm": 0.4743611812591553,
      "learning_rate": 6.427681551582978e-06,
      "loss": 0.0837,
      "mae_dtheta": 0.011364460922777653,
      "mae_dx": 0.002445162506774068,
      "mae_dy": 0.003198683960363269,
      "pose_mae_dtheta": 0.07529556006193161,
      "pose_mae_dx": 0.0326676182448864,
      "pose_mae_dy": 0.0317261666059494,
      "pose_rmse_dtheta": 0.19857272505760193,
      "pose_rmse_dx": 0.10143239796161652,
      "pose_rmse_dy": 0.08221310377120972,
      "pose_rmse_mean": 0.12740609049797058,
      "rmse_dtheta": 0.0257958322763443,
      "rmse_dx": 0.006840689107775688,
      "rmse_dy": 0.007484775502234697,
      "rmse_mean": 0.013373766094446182,
      "rotation_flip": 0.0018594273133203387,
      "sparse_tokens": 32089.0,
      "step": 4966,
      "turn_loss": 0.09201540052890778,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11344.0,
      "epoch": 0.23076565694108903,
      "grad_norm": 0.7117071151733398,
      "learning_rate": 6.426414329318451e-06,
      "loss": 0.1984,
      "mae_dtheta": 0.03312942758202553,
      "mae_dx": 0.00906130950897932,
      "mae_dy": 0.005642659496515989,
      "pose_mae_dtheta": 0.2648438513278961,
      "pose_mae_dx": 0.07142455130815506,
      "pose_mae_dy": 0.08694740384817123,
      "pose_rmse_dtheta": 0.4276514947414398,
      "pose_rmse_dx": 0.16297489404678345,
      "pose_rmse_dy": 0.18039080500602722,
      "pose_rmse_mean": 0.2570057511329651,
      "rmse_dtheta": 0.04786599799990654,
      "rmse_dx": 0.020748279988765717,
      "rmse_dy": 0.009382260963320732,
      "rmse_mean": 0.02599884569644928,
      "rotation_flip": 0.009208102710545063,
      "sparse_tokens": 8638.0,
      "step": 4967,
      "turn_loss": 0.2682662010192871,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.2308121167069318,
      "grad_norm": 0.7246371507644653,
      "learning_rate": 6.425147007304005e-06,
      "loss": 0.0849,
      "mae_dtheta": 0.03929602727293968,
      "mae_dx": 0.0114073995500803,
      "mae_dy": 0.0046112327836453915,
      "pose_mae_dtheta": 0.31852051615715027,
      "pose_mae_dx": 0.08824104815721512,
      "pose_mae_dy": 0.051189642399549484,
      "pose_rmse_dtheta": 0.5772673487663269,
      "pose_rmse_dx": 0.1849440187215805,
      "pose_rmse_dy": 0.10405447334051132,
      "pose_rmse_mean": 0.28875529766082764,
      "rmse_dtheta": 0.058501869440078735,
      "rmse_dx": 0.022006845101714134,
      "rmse_dy": 0.008044769056141376,
      "rmse_mean": 0.029517829418182373,
      "rotation_flip": 0.019607843831181526,
      "sparse_tokens": 8046.0,
      "step": 4968,
      "turn_loss": 0.24053041636943817,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.23085857647277458,
      "grad_norm": 0.561000406742096,
      "learning_rate": 6.423879585628262e-06,
      "loss": 0.1159,
      "mae_dtheta": 0.010443359613418579,
      "mae_dx": 0.002481696894392371,
      "mae_dy": 0.003034354653209448,
      "pose_mae_dtheta": 0.06751725822687149,
      "pose_mae_dx": 0.029260827228426933,
      "pose_mae_dy": 0.02624138817191124,
      "pose_rmse_dtheta": 0.16221491992473602,
      "pose_rmse_dx": 0.09310153871774673,
      "pose_rmse_dy": 0.06077013909816742,
      "pose_rmse_mean": 0.10536219924688339,
      "rmse_dtheta": 0.022024011239409447,
      "rmse_dx": 0.008876465260982513,
      "rmse_dy": 0.007575909607112408,
      "rmse_mean": 0.01282546203583479,
      "rotation_flip": 0.004310344811528921,
      "sparse_tokens": 32137.0,
      "step": 4969,
      "turn_loss": 0.10564000904560089,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.23090503623861736,
      "grad_norm": 0.5380331873893738,
      "learning_rate": 6.422612064379856e-06,
      "loss": 0.1362,
      "mae_dtheta": 0.011194157414138317,
      "mae_dx": 0.0019966831896454096,
      "mae_dy": 0.0027617926243692636,
      "pose_mae_dtheta": 0.07503000646829605,
      "pose_mae_dx": 0.026863452047109604,
      "pose_mae_dy": 0.030646756291389465,
      "pose_rmse_dtheta": 0.1935698539018631,
      "pose_rmse_dx": 0.06262484192848206,
      "pose_rmse_dy": 0.06599710136651993,
      "pose_rmse_mean": 0.10739727318286896,
      "rmse_dtheta": 0.02299029938876629,
      "rmse_dx": 0.004932333715260029,
      "rmse_dy": 0.005608618725091219,
      "rmse_mean": 0.011177084408700466,
      "rotation_flip": 0.006884058006107807,
      "sparse_tokens": 32121.0,
      "step": 4970,
      "turn_loss": 0.08972404152154922,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.23095149600446013,
      "grad_norm": 0.6037476062774658,
      "learning_rate": 6.421344443647425e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.010641896165907383,
      "mae_dx": 0.0018982829060405493,
      "mae_dy": 0.002596674021333456,
      "pose_mae_dtheta": 0.07314528524875641,
      "pose_mae_dx": 0.024111701175570488,
      "pose_mae_dy": 0.029472054913640022,
      "pose_rmse_dtheta": 0.18277129530906677,
      "pose_rmse_dx": 0.05770237743854523,
      "pose_rmse_dy": 0.07002302259206772,
      "pose_rmse_mean": 0.1034988984465599,
      "rmse_dtheta": 0.0218551866710186,
      "rmse_dx": 0.005979549139738083,
      "rmse_dy": 0.005643474403768778,
      "rmse_mean": 0.011159404180943966,
      "rotation_flip": 0.005805515218526125,
      "sparse_tokens": 32137.0,
      "step": 4971,
      "turn_loss": 0.08276382833719254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2309979557703029,
      "grad_norm": 0.3972198963165283,
      "learning_rate": 6.420076723519615e-06,
      "loss": 0.0764,
      "mae_dtheta": 0.008547606877982616,
      "mae_dx": 0.001426720293238759,
      "mae_dy": 0.0010896046878769994,
      "pose_mae_dtheta": 0.05745590105652809,
      "pose_mae_dx": 0.014796522445976734,
      "pose_mae_dy": 0.0125423027202487,
      "pose_rmse_dtheta": 0.19942857325077057,
      "pose_rmse_dx": 0.03808329626917839,
      "pose_rmse_dy": 0.038048822432756424,
      "pose_rmse_mean": 0.09185357391834259,
      "rmse_dtheta": 0.026660090312361717,
      "rmse_dx": 0.004302361514419317,
      "rmse_dy": 0.002661920851096511,
      "rmse_mean": 0.011208124458789825,
      "rotation_flip": 0.0018903592135757208,
      "sparse_tokens": 32169.0,
      "step": 4972,
      "turn_loss": 0.06160491332411766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2310444155361457,
      "grad_norm": 0.5986006259918213,
      "learning_rate": 6.418808904085076e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.010616403073072433,
      "mae_dx": 0.0017316483426839113,
      "mae_dy": 0.002628432121127844,
      "pose_mae_dtheta": 0.06962986290454865,
      "pose_mae_dx": 0.021214570850133896,
      "pose_mae_dy": 0.020355306565761566,
      "pose_rmse_dtheta": 0.21909654140472412,
      "pose_rmse_dx": 0.06457094848155975,
      "pose_rmse_dy": 0.04727398604154587,
      "pose_rmse_mean": 0.11031383275985718,
      "rmse_dtheta": 0.026408787816762924,
      "rmse_dx": 0.004817743320018053,
      "rmse_dy": 0.006086381617933512,
      "rmse_mean": 0.012437637895345688,
      "rotation_flip": 0.005132591817528009,
      "sparse_tokens": 32089.0,
      "step": 4973,
      "turn_loss": 0.08220311254262924,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.2310908753019885,
      "grad_norm": 0.45067036151885986,
      "learning_rate": 6.417540985432469e-06,
      "loss": 0.0804,
      "mae_dtheta": 0.025032268837094307,
      "mae_dx": 0.006518341135233641,
      "mae_dy": 0.0052065192721784115,
      "pose_mae_dtheta": 0.2071000635623932,
      "pose_mae_dx": 0.06622201204299927,
      "pose_mae_dy": 0.0763697698712349,
      "pose_rmse_dtheta": 0.37726396322250366,
      "pose_rmse_dx": 0.17744708061218262,
      "pose_rmse_dy": 0.1859818994998932,
      "pose_rmse_mean": 0.24689766764640808,
      "rmse_dtheta": 0.040856506675481796,
      "rmse_dx": 0.017396312206983566,
      "rmse_dy": 0.010376445949077606,
      "rmse_mean": 0.022876422852277756,
      "rotation_flip": 0.011086474172770977,
      "sparse_tokens": 12471.0,
      "step": 4974,
      "turn_loss": 0.2067171186208725,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23113733506783127,
      "grad_norm": 0.7057216763496399,
      "learning_rate": 6.41627296765046e-06,
      "loss": 0.189,
      "mae_dtheta": 0.01339709386229515,
      "mae_dx": 0.0020297057926654816,
      "mae_dy": 0.0030008957255631685,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7057216763496399,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.82562255859375,
      "model/head/act_norm_mean": 115.55235953282828,
      "model/head/act_norm_min": 65.65438842773438,
      "model/head/act_over_embed": 79.40866328919387,
      "model/head/grad_frac": 0.09805572032928467,
      "model/head/grad_norm": 0.0692000463604927,
      "model/head/grad_zero_frac": 0.0001935357868205756,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6964025015782829,
      "model/head/update_ratio": 0.0011854012263938785,
      "model/head/weight_delta": 8.27529239654541,
      "model/head/weight_delta_rel": 0.14517314732074738,
      "model/head/weight_norm": 58.37689971923828,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4197685718536377,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41969806791970093,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41963520646095276,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2884204415496371,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06092069298028946,
      "model/modality_embedder.encoders.pose/grad_norm": 0.042993053793907166,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5234551753393665,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013908213004469872,
      "model/modality_embedder.encoders.pose/weight_delta": 2.705815553665161,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08840742707252502,
      "model/modality_embedder.encoders.pose/weight_norm": 30.911989212036133,
      "model/modality_embedder/grad_frac": 0.06092069298028946,
      "model/modality_embedder/grad_norm": 0.042993053793907166,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5234551753393665,
      "model/modality_embedder/update_ratio": 0.0013908213004469872,
      "model/modality_embedder/weight_delta": 2.705815553665161,
      "model/modality_embedder/weight_delta_rel": 0.08840742707252502,
      "model/modality_embedder/weight_norm": 30.911989212036133,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.15673828125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.099081088664423,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.090033531188965,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.561114143282033,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08827967941761017,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06230088323354721,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002240407047793269,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.0329647064208984,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07408246397972107,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.807842254638672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.83975982666016,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.09809904601571,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.432814598083496,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.247648636527313,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08071796596050262,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05696441978216171,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019297617254778743,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.5754213333129883,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08921460807323456,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.518888473510742,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.66966247558594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.930903779862113,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.583974838256836,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.507169208614823,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08589736372232437,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06061963364481926,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001989188604056835,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.7707464694976807,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0930364802479744,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.47455406188965,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.43196868896484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.740024250440918,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.416388511657715,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.75041373324927,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08609847724437714,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06076156347990036,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020420365035533905,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.363342523574829,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08076783269643784,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.755374908447266,
      "model/normalizer/grad_frac": 0.34382784366607666,
      "model/normalizer/grad_norm": 0.24264676868915558,
      "model/normalizer/grad_zero_frac": 0.00020207726629450917,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0030959658324718475,
      "model/normalizer/weight_delta": 5.01614236831665,
      "model/normalizer/weight_delta_rel": 0.06460501253604889,
      "model/normalizer/weight_norm": 78.3751449584961,
      "pose_mae_dtheta": 0.09102629125118256,
      "pose_mae_dx": 0.025031432509422302,
      "pose_mae_dy": 0.03720327466726303,
      "pose_rmse_dtheta": 0.20451940596103668,
      "pose_rmse_dx": 0.06496381014585495,
      "pose_rmse_dy": 0.08928143233060837,
      "pose_rmse_mean": 0.1195882186293602,
      "rmse_dtheta": 0.027857257053256035,
      "rmse_dx": 0.006183521822094917,
      "rmse_dy": 0.007338248193264008,
      "rmse_mean": 0.013793009333312511,
      "rotation_flip": 0.004125412553548813,
      "sparse_tokens": 32089.0,
      "step": 4975,
      "turn_loss": 0.11955008655786514,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23118379483367404,
      "grad_norm": 0.46998482942581177,
      "learning_rate": 6.4150048508277215e-06,
      "loss": 0.1272,
      "mae_dtheta": 0.011884493753314018,
      "mae_dx": 0.0022812006063759327,
      "mae_dy": 0.0033327622804790735,
      "pose_mae_dtheta": 0.078739233314991,
      "pose_mae_dx": 0.031048409640789032,
      "pose_mae_dy": 0.035536423325538635,
      "pose_rmse_dtheta": 0.15115047991275787,
      "pose_rmse_dx": 0.07868071645498276,
      "pose_rmse_dy": 0.07328581064939499,
      "pose_rmse_mean": 0.10103900730609894,
      "rmse_dtheta": 0.02217736467719078,
      "rmse_dx": 0.006857790052890778,
      "rmse_dy": 0.007418470922857523,
      "rmse_mean": 0.012151209637522697,
      "rotation_flip": 0.0040955631993710995,
      "sparse_tokens": 32105.0,
      "step": 4976,
      "turn_loss": 0.11260512471199036,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.23123025459951682,
      "grad_norm": 0.4939557909965515,
      "learning_rate": 6.413736635052936e-06,
      "loss": 0.1156,
      "mae_dtheta": 0.04246082529425621,
      "mae_dx": 0.011005859822034836,
      "mae_dy": 0.008327238261699677,
      "pose_mae_dtheta": 0.30654972791671753,
      "pose_mae_dx": 0.07021600008010864,
      "pose_mae_dy": 0.11115730553865433,
      "pose_rmse_dtheta": 0.49442821741104126,
      "pose_rmse_dx": 0.13150328397750854,
      "pose_rmse_dy": 0.2578405737876892,
      "pose_rmse_mean": 0.29459071159362793,
      "rmse_dtheta": 0.062256649136543274,
      "rmse_dx": 0.02133828215301037,
      "rmse_dy": 0.018841195851564407,
      "rmse_mean": 0.034145377576351166,
      "rotation_flip": 0.013100436888635159,
      "sparse_tokens": 4136.0,
      "step": 4977,
      "turn_loss": 0.3693107068538666,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2312767143653596,
      "grad_norm": 0.561877429485321,
      "learning_rate": 6.412468320414789e-06,
      "loss": 0.1687,
      "mae_dtheta": 0.010609212331473827,
      "mae_dx": 0.0019016657024621964,
      "mae_dy": 0.002294185571372509,
      "pose_mae_dtheta": 0.06499428302049637,
      "pose_mae_dx": 0.023287951946258545,
      "pose_mae_dy": 0.028256230056285858,
      "pose_rmse_dtheta": 0.1367826759815216,
      "pose_rmse_dx": 0.05530400201678276,
      "pose_rmse_dy": 0.0687459260225296,
      "pose_rmse_mean": 0.08694420754909515,
      "rmse_dtheta": 0.020927557721734047,
      "rmse_dx": 0.005307147279381752,
      "rmse_dy": 0.004756840877234936,
      "rmse_mean": 0.010330515913665295,
      "rotation_flip": 0.004506195895373821,
      "sparse_tokens": 32105.0,
      "step": 4978,
      "turn_loss": 0.09139565378427505,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.23132317413120237,
      "grad_norm": 0.655994713306427,
      "learning_rate": 6.411199907001974e-06,
      "loss": 0.1865,
      "mae_dtheta": 0.013981880620121956,
      "mae_dx": 0.0024381361436098814,
      "mae_dy": 0.003870246233418584,
      "pose_mae_dtheta": 0.09922290593385696,
      "pose_mae_dx": 0.03340642899274826,
      "pose_mae_dy": 0.04263288155198097,
      "pose_rmse_dtheta": 0.20871002972126007,
      "pose_rmse_dx": 0.09500311315059662,
      "pose_rmse_dy": 0.1230430006980896,
      "pose_rmse_mean": 0.14225205779075623,
      "rmse_dtheta": 0.026088334619998932,
      "rmse_dx": 0.00646496657282114,
      "rmse_dy": 0.009262827225029469,
      "rmse_mean": 0.013938709162175655,
      "rotation_flip": 0.00459201680496335,
      "sparse_tokens": 32121.0,
      "step": 4979,
      "turn_loss": 0.11903609335422516,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.23136963389704515,
      "grad_norm": 0.5535283088684082,
      "learning_rate": 6.409931394903191e-06,
      "loss": 0.0703,
      "mae_dtheta": 0.010525871999561787,
      "mae_dx": 0.0018003075383603573,
      "mae_dy": 0.0019775638356804848,
      "pose_mae_dtheta": 0.0637417882680893,
      "pose_mae_dx": 0.019830860197544098,
      "pose_mae_dy": 0.023661555722355843,
      "pose_rmse_dtheta": 0.13717316091060638,
      "pose_rmse_dx": 0.04513489454984665,
      "pose_rmse_dy": 0.05781945213675499,
      "pose_rmse_mean": 0.08004250377416611,
      "rmse_dtheta": 0.022353047505021095,
      "rmse_dx": 0.005354310851544142,
      "rmse_dy": 0.004282994661480188,
      "rmse_mean": 0.010663451626896858,
      "rotation_flip": 0.011583011597394943,
      "sparse_tokens": 32137.0,
      "step": 4980,
      "turn_loss": 0.08153718709945679,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.23141609366288793,
      "grad_norm": 0.9622902274131775,
      "learning_rate": 6.408662784207149e-06,
      "loss": 0.2805,
      "mae_dtheta": 0.035818178206682205,
      "mae_dx": 0.01364088710397482,
      "mae_dy": 0.007825873792171478,
      "pose_mae_dtheta": 0.28079739212989807,
      "pose_mae_dx": 0.10931673645973206,
      "pose_mae_dy": 0.07948549091815948,
      "pose_rmse_dtheta": 0.5112181901931763,
      "pose_rmse_dx": 0.2358497679233551,
      "pose_rmse_dy": 0.19224533438682556,
      "pose_rmse_mean": 0.31310445070266724,
      "rmse_dtheta": 0.05517292395234108,
      "rmse_dx": 0.026003582403063774,
      "rmse_dy": 0.017511317506432533,
      "rmse_mean": 0.03289594128727913,
      "rotation_flip": 0.016260161995887756,
      "sparse_tokens": 19948.0,
      "step": 4981,
      "turn_loss": 0.267259418964386,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.23146255342873073,
      "grad_norm": 0.6606153249740601,
      "learning_rate": 6.407394075002562e-06,
      "loss": 0.1265,
      "mae_dtheta": 0.02456899732351303,
      "mae_dx": 0.01799878664314747,
      "mae_dy": 0.011187121272087097,
      "pose_mae_dtheta": 0.17830055952072144,
      "pose_mae_dx": 0.13004910945892334,
      "pose_mae_dy": 0.1404653936624527,
      "pose_rmse_dtheta": 0.2822236716747284,
      "pose_rmse_dx": 0.26766225695610046,
      "pose_rmse_dy": 0.26492953300476074,
      "pose_rmse_mean": 0.27160516381263733,
      "rmse_dtheta": 0.0356193408370018,
      "rmse_dx": 0.03254332020878792,
      "rmse_dy": 0.016803011298179626,
      "rmse_mean": 0.028321892023086548,
      "rotation_flip": 0.020066889002919197,
      "sparse_tokens": 4994.0,
      "step": 4982,
      "turn_loss": 0.2707783281803131,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2315090131945735,
      "grad_norm": 0.49119651317596436,
      "learning_rate": 6.4061252673781534e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.010204440914094448,
      "mae_dx": 0.0012284645345062017,
      "mae_dy": 0.002027824055403471,
      "pose_mae_dtheta": 0.06474608182907104,
      "pose_mae_dx": 0.0164872445166111,
      "pose_mae_dy": 0.023429682478308678,
      "pose_rmse_dtheta": 0.1881546527147293,
      "pose_rmse_dx": 0.03791927546262741,
      "pose_rmse_dy": 0.05251724645495415,
      "pose_rmse_mean": 0.09286372363567352,
      "rmse_dtheta": 0.025228267535567284,
      "rmse_dx": 0.0030763973481953144,
      "rmse_dy": 0.004403948318213224,
      "rmse_mean": 0.010902870446443558,
      "rotation_flip": 0.0058846608735620975,
      "sparse_tokens": 32121.0,
      "step": 4983,
      "turn_loss": 0.07058406621217728,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31046.0,
      "epoch": 0.2315554729604163,
      "grad_norm": 0.6939326524734497,
      "learning_rate": 6.404856361422649e-06,
      "loss": 0.0946,
      "mae_dtheta": 0.030784785747528076,
      "mae_dx": 0.010556086897850037,
      "mae_dy": 0.005761140026152134,
      "pose_mae_dtheta": 0.23793330788612366,
      "pose_mae_dx": 0.08626976609230042,
      "pose_mae_dy": 0.09552367031574249,
      "pose_rmse_dtheta": 0.4124428331851959,
      "pose_rmse_dx": 0.2054772824048996,
      "pose_rmse_dy": 0.19015255570411682,
      "pose_rmse_mean": 0.2693575620651245,
      "rmse_dtheta": 0.04624379798769951,
      "rmse_dx": 0.023454708978533745,
      "rmse_dy": 0.009746887721121311,
      "rmse_mean": 0.02648179791867733,
      "rotation_flip": 0.016628874465823174,
      "sparse_tokens": 24600.0,
      "step": 4984,
      "turn_loss": 0.236678346991539,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 30077.0,
      "epoch": 0.23160193272625906,
      "grad_norm": 0.638090193271637,
      "learning_rate": 6.403587357224786e-06,
      "loss": 0.1743,
      "mae_dtheta": 0.04848923161625862,
      "mae_dx": 0.016674350947141647,
      "mae_dy": 0.005609861109405756,
      "pose_mae_dtheta": 0.3999309539794922,
      "pose_mae_dx": 0.1289738267660141,
      "pose_mae_dy": 0.06533563137054443,
      "pose_rmse_dtheta": 0.6683323383331299,
      "pose_rmse_dx": 0.2580812871456146,
      "pose_rmse_dy": 0.15239651501178741,
      "pose_rmse_mean": 0.3596034049987793,
      "rmse_dtheta": 0.06841062754392624,
      "rmse_dx": 0.029455695301294327,
      "rmse_dy": 0.011617280542850494,
      "rmse_mean": 0.03649453818798065,
      "rotation_flip": 0.00845253560692072,
      "sparse_tokens": 23652.0,
      "step": 4985,
      "turn_loss": 0.38889172673225403,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.23164839249210184,
      "grad_norm": 0.5169478058815002,
      "learning_rate": 6.402318254873305e-06,
      "loss": 0.1224,
      "mae_dtheta": 0.034729961305856705,
      "mae_dx": 0.008193260058760643,
      "mae_dy": 0.0020357093308120966,
      "pose_mae_dtheta": 0.27591201663017273,
      "pose_mae_dx": 0.059593357145786285,
      "pose_mae_dy": 0.021592464298009872,
      "pose_rmse_dtheta": 0.5632185339927673,
      "pose_rmse_dx": 0.14530785381793976,
      "pose_rmse_dy": 0.053006820380687714,
      "pose_rmse_mean": 0.25384441018104553,
      "rmse_dtheta": 0.05934418737888336,
      "rmse_dx": 0.01903364062309265,
      "rmse_dy": 0.004749844782054424,
      "rmse_mean": 0.027709223330020905,
      "rotation_flip": 0.003929273225367069,
      "sparse_tokens": 8534.0,
      "step": 4986,
      "turn_loss": 0.18646034598350525,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.23169485225794462,
      "grad_norm": 0.42926621437072754,
      "learning_rate": 6.401049054456957e-06,
      "loss": 0.099,
      "mae_dtheta": 0.03498470038175583,
      "mae_dx": 0.010592086240649223,
      "mae_dy": 0.005090394522994757,
      "pose_mae_dtheta": 0.27069753408432007,
      "pose_mae_dx": 0.09464097768068314,
      "pose_mae_dy": 0.06259160488843918,
      "pose_rmse_dtheta": 0.4846641719341278,
      "pose_rmse_dx": 0.2165554165840149,
      "pose_rmse_dy": 0.1265866607427597,
      "pose_rmse_mean": 0.27593541145324707,
      "rmse_dtheta": 0.05357031524181366,
      "rmse_dx": 0.02291230484843254,
      "rmse_dy": 0.009634451009333134,
      "rmse_mean": 0.028705691918730736,
      "rotation_flip": 0.014210919849574566,
      "sparse_tokens": 25343.0,
      "step": 4987,
      "turn_loss": 0.2742256224155426,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2317413120237874,
      "grad_norm": 0.8438337445259094,
      "learning_rate": 6.399779756064496e-06,
      "loss": 0.1313,
      "mae_dtheta": 0.006932039745151997,
      "mae_dx": 0.001838312717154622,
      "mae_dy": 0.0015786206349730492,
      "pose_mae_dtheta": 0.04874953255057335,
      "pose_mae_dx": 0.016644373536109924,
      "pose_mae_dy": 0.01643179915845394,
      "pose_rmse_dtheta": 0.1550702601671219,
      "pose_rmse_dx": 0.041520856320858,
      "pose_rmse_dy": 0.03837641701102257,
      "pose_rmse_mean": 0.07832251489162445,
      "rmse_dtheta": 0.02056354284286499,
      "rmse_dx": 0.006189195904880762,
      "rmse_dy": 0.005744917783886194,
      "rmse_mean": 0.01083255186676979,
      "rotation_flip": 0.0032626427710056305,
      "sparse_tokens": 32089.0,
      "step": 4988,
      "turn_loss": 0.06711626797914505,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23178777178963017,
      "grad_norm": 0.6697083711624146,
      "learning_rate": 6.398510359784685e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.011378856375813484,
      "mae_dx": 0.002010751748457551,
      "mae_dy": 0.0028386672493070364,
      "pose_mae_dtheta": 0.08057233691215515,
      "pose_mae_dx": 0.02776014432311058,
      "pose_mae_dy": 0.033584512770175934,
      "pose_rmse_dtheta": 0.1767692267894745,
      "pose_rmse_dx": 0.06666345149278641,
      "pose_rmse_dy": 0.07172442227602005,
      "pose_rmse_mean": 0.10505236685276031,
      "rmse_dtheta": 0.02320336550474167,
      "rmse_dx": 0.006062803324311972,
      "rmse_dy": 0.006698891520500183,
      "rmse_mean": 0.011988354846835136,
      "rotation_flip": 0.004142215941101313,
      "sparse_tokens": 32105.0,
      "step": 4989,
      "turn_loss": 0.0954093188047409,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.23183423155547295,
      "grad_norm": 0.8350178599357605,
      "learning_rate": 6.397240865706295e-06,
      "loss": 0.1619,
      "mae_dtheta": 0.015634043142199516,
      "mae_dx": 0.0017497676890343428,
      "mae_dy": 0.003515004413202405,
      "pose_mae_dtheta": 0.11558237671852112,
      "pose_mae_dx": 0.029962055385112762,
      "pose_mae_dy": 0.04642309248447418,
      "pose_rmse_dtheta": 0.2683846354484558,
      "pose_rmse_dx": 0.07981348782777786,
      "pose_rmse_dy": 0.11649089306592941,
      "pose_rmse_mean": 0.1548963487148285,
      "rmse_dtheta": 0.030432704836130142,
      "rmse_dx": 0.005039256997406483,
      "rmse_dy": 0.008843142539262772,
      "rmse_mean": 0.014771701768040657,
      "rotation_flip": 0.0035005833487957716,
      "sparse_tokens": 32057.0,
      "step": 4990,
      "turn_loss": 0.13159096240997314,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.23188069132131575,
      "grad_norm": 0.5399569272994995,
      "learning_rate": 6.3959712739181e-06,
      "loss": 0.1041,
      "mae_dtheta": 0.009252767078578472,
      "mae_dx": 0.0019715509843081236,
      "mae_dy": 0.0024005756713449955,
      "pose_mae_dtheta": 0.05845644325017929,
      "pose_mae_dx": 0.02582242526113987,
      "pose_mae_dy": 0.0223687794059515,
      "pose_rmse_dtheta": 0.14096979796886444,
      "pose_rmse_dx": 0.08578938990831375,
      "pose_rmse_dy": 0.05300270766019821,
      "pose_rmse_mean": 0.0932539701461792,
      "rmse_dtheta": 0.02140176109969616,
      "rmse_dx": 0.006046217866241932,
      "rmse_dy": 0.006680520251393318,
      "rmse_mean": 0.01137616764754057,
      "rotation_flip": 0.001515725627541542,
      "sparse_tokens": 32137.0,
      "step": 4991,
      "turn_loss": 0.08093127608299255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.23192715108715853,
      "grad_norm": 0.5352692008018494,
      "learning_rate": 6.3947015845088845e-06,
      "loss": 0.0942,
      "mae_dtheta": 0.011074603535234928,
      "mae_dx": 0.0017021708190441132,
      "mae_dy": 0.0026040091179311275,
      "pose_mae_dtheta": 0.07765159755945206,
      "pose_mae_dx": 0.023211563006043434,
      "pose_mae_dy": 0.028150515630841255,
      "pose_rmse_dtheta": 0.21512135863304138,
      "pose_rmse_dx": 0.06907231360673904,
      "pose_rmse_dy": 0.06817704439163208,
      "pose_rmse_mean": 0.11745690554380417,
      "rmse_dtheta": 0.024510672315955162,
      "rmse_dx": 0.005509880371391773,
      "rmse_dy": 0.007147664669901133,
      "rmse_mean": 0.012389406561851501,
      "rotation_flip": 0.003443822730332613,
      "sparse_tokens": 32057.0,
      "step": 4992,
      "turn_loss": 0.0804586112499237,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28785.0,
      "epoch": 0.2319736108530013,
      "grad_norm": 0.43999969959259033,
      "learning_rate": 6.39343179756744e-06,
      "loss": 0.113,
      "mae_dtheta": 0.03233598917722702,
      "mae_dx": 0.014905695803463459,
      "mae_dy": 0.005301658064126968,
      "pose_mae_dtheta": 0.2354586273431778,
      "pose_mae_dx": 0.11267687380313873,
      "pose_mae_dy": 0.07115578651428223,
      "pose_rmse_dtheta": 0.42064806818962097,
      "pose_rmse_dx": 0.2479032278060913,
      "pose_rmse_dy": 0.15603269636631012,
      "pose_rmse_mean": 0.27486133575439453,
      "rmse_dtheta": 0.04866921901702881,
      "rmse_dx": 0.028804585337638855,
      "rmse_dy": 0.009296642616391182,
      "rmse_mean": 0.028923481702804565,
      "rotation_flip": 0.011799409985542297,
      "sparse_tokens": 24023.0,
      "step": 4993,
      "turn_loss": 0.2560492753982544,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.23202007061884408,
      "grad_norm": 0.5671451687812805,
      "learning_rate": 6.39216191318256e-06,
      "loss": 0.0689,
      "mae_dtheta": 0.02217485010623932,
      "mae_dx": 0.0089858528226614,
      "mae_dy": 0.004179892595857382,
      "pose_mae_dtheta": 0.1749986708164215,
      "pose_mae_dx": 0.06654001772403717,
      "pose_mae_dy": 0.05267130583524704,
      "pose_rmse_dtheta": 0.3211989998817444,
      "pose_rmse_dx": 0.15639500319957733,
      "pose_rmse_dy": 0.10380466282367706,
      "pose_rmse_mean": 0.19379955530166626,
      "rmse_dtheta": 0.03679203987121582,
      "rmse_dx": 0.020336776971817017,
      "rmse_dy": 0.007031754124909639,
      "rmse_mean": 0.021386858075857162,
      "rotation_flip": 0.014117646962404251,
      "sparse_tokens": 9840.0,
      "step": 4994,
      "turn_loss": 0.17031288146972656,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.23206653038468686,
      "grad_norm": 0.8083269596099854,
      "learning_rate": 6.3908919314430505e-06,
      "loss": 0.1811,
      "mae_dtheta": 0.03694097697734833,
      "mae_dx": 0.01620672643184662,
      "mae_dy": 0.010688547976315022,
      "pose_mae_dtheta": 0.30004367232322693,
      "pose_mae_dx": 0.13297498226165771,
      "pose_mae_dy": 0.11554685980081558,
      "pose_rmse_dtheta": 0.49617627263069153,
      "pose_rmse_dx": 0.26384249329566956,
      "pose_rmse_dy": 0.28337785601615906,
      "pose_rmse_mean": 0.3477988839149475,
      "rmse_dtheta": 0.05338660255074501,
      "rmse_dx": 0.02840178646147251,
      "rmse_dy": 0.022122101858258247,
      "rmse_mean": 0.034636832773685455,
      "rotation_flip": 0.013752455823123455,
      "sparse_tokens": 16983.0,
      "step": 4995,
      "turn_loss": 0.38576823472976685,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.23211299015052964,
      "grad_norm": 0.4899996519088745,
      "learning_rate": 6.389621852437723e-06,
      "loss": 0.0764,
      "mae_dtheta": 0.008743605576455593,
      "mae_dx": 0.0014199434081092477,
      "mae_dy": 0.0015605725347995758,
      "pose_mae_dtheta": 0.06094002723693848,
      "pose_mae_dx": 0.021768035367131233,
      "pose_mae_dy": 0.02273700013756752,
      "pose_rmse_dtheta": 0.1671442836523056,
      "pose_rmse_dx": 0.05953220650553703,
      "pose_rmse_dy": 0.06388074159622192,
      "pose_rmse_mean": 0.09685241430997849,
      "rmse_dtheta": 0.021191852167248726,
      "rmse_dx": 0.004552803467959166,
      "rmse_dy": 0.003862739307805896,
      "rmse_mean": 0.009869132190942764,
      "rotation_flip": 0.00273348530754447,
      "sparse_tokens": 32121.0,
      "step": 4996,
      "turn_loss": 0.06577377766370773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2321594499163724,
      "grad_norm": 0.6825268268585205,
      "learning_rate": 6.388351676255393e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.009106791578233242,
      "mae_dx": 0.0021576054859906435,
      "mae_dy": 0.002030035713687539,
      "pose_mae_dtheta": 0.06401992589235306,
      "pose_mae_dx": 0.025210408493876457,
      "pose_mae_dy": 0.024943199008703232,
      "pose_rmse_dtheta": 0.15819452702999115,
      "pose_rmse_dx": 0.08623142540454865,
      "pose_rmse_dy": 0.07055089622735977,
      "pose_rmse_mean": 0.10499228537082672,
      "rmse_dtheta": 0.019889457151293755,
      "rmse_dx": 0.007580274250358343,
      "rmse_dy": 0.005271023605018854,
      "rmse_mean": 0.010913586243987083,
      "rotation_flip": 0.0033112582750618458,
      "sparse_tokens": 32089.0,
      "step": 4997,
      "turn_loss": 0.07009179890155792,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2322059096822152,
      "grad_norm": 0.30344176292419434,
      "learning_rate": 6.3870814029848845e-06,
      "loss": 0.0717,
      "mae_dtheta": 0.010940785519778728,
      "mae_dx": 0.0014857822097837925,
      "mae_dy": 0.002045656554400921,
      "pose_mae_dtheta": 0.07991112023591995,
      "pose_mae_dx": 0.019638480618596077,
      "pose_mae_dy": 0.026035064831376076,
      "pose_rmse_dtheta": 0.21670736372470856,
      "pose_rmse_dx": 0.0520269013941288,
      "pose_rmse_dy": 0.06630218774080276,
      "pose_rmse_mean": 0.1116788238286972,
      "rmse_dtheta": 0.024940118193626404,
      "rmse_dx": 0.004224379081279039,
      "rmse_dy": 0.0043261051177978516,
      "rmse_mean": 0.011163534596562386,
      "rotation_flip": 0.004248744808137417,
      "sparse_tokens": 32105.0,
      "step": 4998,
      "turn_loss": 0.08555161952972412,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.232252369448058,
      "grad_norm": 0.5746363997459412,
      "learning_rate": 6.385811032715031e-06,
      "loss": 0.1579,
      "mae_dtheta": 0.014337115921080112,
      "mae_dx": 0.0037047392688691616,
      "mae_dy": 0.003973925486207008,
      "pose_mae_dtheta": 0.10807030647993088,
      "pose_mae_dx": 0.02828153595328331,
      "pose_mae_dy": 0.0362069234251976,
      "pose_rmse_dtheta": 0.3025051951408386,
      "pose_rmse_dx": 0.08378160744905472,
      "pose_rmse_dy": 0.11924175173044205,
      "pose_rmse_mean": 0.16850952804088593,
      "rmse_dtheta": 0.03276455029845238,
      "rmse_dx": 0.012625052593648434,
      "rmse_dy": 0.012055858969688416,
      "rmse_mean": 0.019148487597703934,
      "rotation_flip": 0.01224489789456129,
      "sparse_tokens": 32137.0,
      "step": 4999,
      "turn_loss": 0.1503138244152069,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.23229882921390077,
      "grad_norm": 0.3272332549095154,
      "learning_rate": 6.384540565534665e-06,
      "loss": 0.1021,
      "mae_dtheta": 0.015192692168056965,
      "mae_dx": 0.003225687425583601,
      "mae_dy": 0.005231603514403105,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.32723334431648254,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.38990783691406,
      "model/head/act_norm_mean": 102.7528409090909,
      "model/head/act_norm_min": 37.625221252441406,
      "model/head/act_over_embed": 70.61271425998022,
      "model/head/grad_frac": 0.13301151990890503,
      "model/head/grad_norm": 0.043525803834199905,
      "model/head/grad_zero_frac": 0.00017354765441268682,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.702084319760101,
      "model/head/update_ratio": 0.0007455460727214813,
      "model/head/weight_delta": 8.291252136230469,
      "model/head/weight_delta_rel": 0.14545312523841858,
      "model/head/weight_norm": 58.381107330322266,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41995522379875183,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41989139225929295,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41981157660484314,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2885532958457357,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09321242570877075,
      "model/modality_embedder.encoders.pose/grad_norm": 0.030502213165163994,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5409086044520548,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009867039043456316,
      "model/modality_embedder.encoders.pose/weight_delta": 2.7129406929016113,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0886402279138565,
      "model/modality_embedder.encoders.pose/weight_norm": 30.913238525390625,
      "model/modality_embedder/grad_frac": 0.09321242570877075,
      "model/modality_embedder/grad_norm": 0.030502213165163994,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5409086044520548,
      "model/modality_embedder/update_ratio": 0.0009867039043456316,
      "model/modality_embedder/weight_delta": 2.7129406929016113,
      "model/modality_embedder/weight_delta_rel": 0.0886402279138565,
      "model/modality_embedder/weight_norm": 30.913238525390625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.29484558105469,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.999839666506332,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.223798751831055,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.805705146714656,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10139445215463638,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.033179644495248795,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011930891778320074,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.0394411087036133,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07431846112012863,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.80986213684082,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.0171127319336,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.011025432900432,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 11.822999954223633,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.500601472250978,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0920916348695755,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03013545274734497,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010207974119111896,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.583829402923584,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0895058736205101,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.521482467651367,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.06161499023438,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.96543310084977,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.738152503967285,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.84368871911863,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09088107943534851,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.029739320278167725,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009757974767126143,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.7798349857330322,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0933416560292244,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.476938247680664,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.06455993652344,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.951516654641654,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.608757972717285,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.2085439312916,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09740912169218063,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03187551349401474,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010711537906900048,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.3712942600250244,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08103958517313004,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.75811004638672,
      "model/normalizer/grad_frac": 0.3714815676212311,
      "model/normalizer/grad_norm": 0.12156115472316742,
      "model/normalizer/grad_zero_frac": 0.00023162072466220707,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0015509565128013492,
      "model/normalizer/weight_delta": 5.032591819763184,
      "model/normalizer/weight_delta_rel": 0.06481686979532242,
      "model/normalizer/weight_norm": 78.37818145751953,
      "pose_mae_dtheta": 0.10475804656744003,
      "pose_mae_dx": 0.04147753864526749,
      "pose_mae_dy": 0.044903822243213654,
      "pose_rmse_dtheta": 0.23032663762569427,
      "pose_rmse_dx": 0.10163512080907822,
      "pose_rmse_dy": 0.09164322912693024,
      "pose_rmse_mean": 0.1412016600370407,
      "rmse_dtheta": 0.029623929411172867,
      "rmse_dx": 0.00952091347426176,
      "rmse_dy": 0.011406105943024158,
      "rmse_mean": 0.016850316897034645,
      "rotation_flip": 0.008507853373885155,
      "sparse_tokens": 32073.0,
      "step": 5000,
      "turn_loss": 0.14185060560703278,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.23229882921390077,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3114304542541504,
      "eval_objectnav_nopose_mae_dtheta": 0.040487900376319885,
      "eval_objectnav_nopose_mae_dx": 0.013524346053600311,
      "eval_objectnav_nopose_mae_dy": 0.005339701194316149,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3285253345966339,
      "eval_objectnav_nopose_pose_mae_dx": 0.10793323069810867,
      "eval_objectnav_nopose_pose_mae_dy": 0.05867024138569832,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5538209080696106,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2365526705980301,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1337653249502182,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3080463111400604,
      "eval_objectnav_nopose_rmse_dtheta": 0.05844198167324066,
      "eval_objectnav_nopose_rmse_dx": 0.02617744170129299,
      "eval_objectnav_nopose_rmse_dy": 0.01084988098591566,
      "eval_objectnav_nopose_rmse_mean": 0.03182310238480568,
      "eval_objectnav_nopose_rotation_flip": 0.014628005214035511,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3114304542541504,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 5000
    },
    {
      "epoch": 0.23229882921390077,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28658047318458557,
      "eval_objectnav_pose_mae_dtheta": 0.036368437111377716,
      "eval_objectnav_pose_mae_dx": 0.011334175243973732,
      "eval_objectnav_pose_mae_dy": 0.004828380420804024,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2742472290992737,
      "eval_objectnav_pose_pose_mae_dx": 0.09090683609247208,
      "eval_objectnav_pose_pose_mae_dy": 0.05046931654214859,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4839981198310852,
      "eval_objectnav_pose_pose_rmse_dx": 0.20816034078598022,
      "eval_objectnav_pose_pose_rmse_dy": 0.11855822056531906,
      "eval_objectnav_pose_pose_rmse_mean": 0.2702389061450958,
      "eval_objectnav_pose_rmse_dtheta": 0.05443107709288597,
      "eval_objectnav_pose_rmse_dx": 0.023482799530029297,
      "eval_objectnav_pose_rmse_dy": 0.009937867522239685,
      "eval_objectnav_pose_rmse_mean": 0.0292839165776968,
      "eval_objectnav_pose_rotation_flip": 0.01446317508816719,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28658047318458557,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 5000
    },
    {
      "epoch": 0.23229882921390077,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09683022648096085,
      "eval_pointnav_mae_dtheta": 0.010688511654734612,
      "eval_pointnav_mae_dx": 0.0025896017905324697,
      "eval_pointnav_mae_dy": 0.0025255607906728983,
      "eval_pointnav_pose_mae_dtheta": 0.07538847625255585,
      "eval_pointnav_pose_mae_dx": 0.028702983632683754,
      "eval_pointnav_pose_mae_dy": 0.027583302929997444,
      "eval_pointnav_pose_rmse_dtheta": 0.20549210906028748,
      "eval_pointnav_pose_rmse_dx": 0.08714310824871063,
      "eval_pointnav_pose_rmse_dy": 0.07784654945135117,
      "eval_pointnav_pose_rmse_mean": 0.12349392473697662,
      "eval_pointnav_rmse_dtheta": 0.02552213706076145,
      "eval_pointnav_rmse_dx": 0.008137869648635387,
      "eval_pointnav_rmse_dy": 0.006735282950103283,
      "eval_pointnav_rmse_mean": 0.013465097174048424,
      "eval_pointnav_rotation_flip": 0.005433827638626099,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09683022648096085,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 5000
    },
    {
      "epoch": 0.23229882921390077,
      "eval_loss": 0.23161371797323227,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3114304542541504,
      "eval_objectnav_nopose_mae_dtheta": 0.040487900376319885,
      "eval_objectnav_nopose_mae_dx": 0.013524346053600311,
      "eval_objectnav_nopose_mae_dy": 0.005339701194316149,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3285253345966339,
      "eval_objectnav_nopose_pose_mae_dx": 0.10793323069810867,
      "eval_objectnav_nopose_pose_mae_dy": 0.05867024138569832,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5538209080696106,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2365526705980301,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1337653249502182,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3080463111400604,
      "eval_objectnav_nopose_rmse_dtheta": 0.05844198167324066,
      "eval_objectnav_nopose_rmse_dx": 0.02617744170129299,
      "eval_objectnav_nopose_rmse_dy": 0.01084988098591566,
      "eval_objectnav_nopose_rmse_mean": 0.03182310238480568,
      "eval_objectnav_nopose_rotation_flip": 0.014628005214035511,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3114304542541504,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28658047318458557,
      "eval_objectnav_pose_mae_dtheta": 0.036368437111377716,
      "eval_objectnav_pose_mae_dx": 0.011334175243973732,
      "eval_objectnav_pose_mae_dy": 0.004828380420804024,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2742472290992737,
      "eval_objectnav_pose_pose_mae_dx": 0.09090683609247208,
      "eval_objectnav_pose_pose_mae_dy": 0.05046931654214859,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4839981198310852,
      "eval_objectnav_pose_pose_rmse_dx": 0.20816034078598022,
      "eval_objectnav_pose_pose_rmse_dy": 0.11855822056531906,
      "eval_objectnav_pose_pose_rmse_mean": 0.2702389061450958,
      "eval_objectnav_pose_rmse_dtheta": 0.05443107709288597,
      "eval_objectnav_pose_rmse_dx": 0.023482799530029297,
      "eval_objectnav_pose_rmse_dy": 0.009937867522239685,
      "eval_objectnav_pose_rmse_mean": 0.0292839165776968,
      "eval_objectnav_pose_rotation_flip": 0.01446317508816719,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28658047318458557,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09683022648096085,
      "eval_pointnav_mae_dtheta": 0.010688511654734612,
      "eval_pointnav_mae_dx": 0.0025896017905324697,
      "eval_pointnav_mae_dy": 0.0025255607906728983,
      "eval_pointnav_pose_mae_dtheta": 0.07538847625255585,
      "eval_pointnav_pose_mae_dx": 0.028702983632683754,
      "eval_pointnav_pose_mae_dy": 0.027583302929997444,
      "eval_pointnav_pose_rmse_dtheta": 0.20549210906028748,
      "eval_pointnav_pose_rmse_dx": 0.08714310824871063,
      "eval_pointnav_pose_rmse_dy": 0.07784654945135117,
      "eval_pointnav_pose_rmse_mean": 0.12349392473697662,
      "eval_pointnav_rmse_dtheta": 0.02552213706076145,
      "eval_pointnav_rmse_dx": 0.008137869648635387,
      "eval_pointnav_rmse_dy": 0.006735282950103283,
      "eval_pointnav_rmse_mean": 0.013465097174048424,
      "eval_pointnav_rotation_flip": 0.005433827638626099,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09683022648096085,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 5000
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.23234528897974355,
      "grad_norm": 0.4924643933773041,
      "learning_rate": 6.383270001532636e-06,
      "loss": 0.1066,
      "mae_dtheta": 0.010934960097074509,
      "mae_dx": 0.0020195585675537586,
      "mae_dy": 0.00215592747554183,
      "pose_mae_dtheta": 0.06285794824361801,
      "pose_mae_dx": 0.02195408008992672,
      "pose_mae_dy": 0.025351272895932198,
      "pose_rmse_dtheta": 0.1498873382806778,
      "pose_rmse_dx": 0.054433513432741165,
      "pose_rmse_dy": 0.058290995657444,
      "pose_rmse_mean": 0.08753728121519089,
      "rmse_dtheta": 0.023115839809179306,
      "rmse_dx": 0.005603770725429058,
      "rmse_dy": 0.004901533480733633,
      "rmse_mean": 0.01120704784989357,
      "rotation_flip": 0.004611837211996317,
      "sparse_tokens": 32169.0,
      "step": 5001,
      "turn_loss": 0.09554103016853333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.23239174874558632,
      "grad_norm": 0.5745016932487488,
      "learning_rate": 6.381999340797793e-06,
      "loss": 0.1231,
      "mae_dtheta": 0.02596549689769745,
      "mae_dx": 0.011068635620176792,
      "mae_dy": 0.005343084689229727,
      "pose_mae_dtheta": 0.1751021295785904,
      "pose_mae_dx": 0.07384886592626572,
      "pose_mae_dy": 0.07062839716672897,
      "pose_rmse_dtheta": 0.2859947085380554,
      "pose_rmse_dx": 0.1528085321187973,
      "pose_rmse_dy": 0.15553787350654602,
      "pose_rmse_mean": 0.19811372458934784,
      "rmse_dtheta": 0.038852524012327194,
      "rmse_dx": 0.022249728441238403,
      "rmse_dy": 0.010885602794587612,
      "rmse_mean": 0.02399595081806183,
      "rotation_flip": 0.015625,
      "sparse_tokens": 5696.0,
      "step": 5002,
      "turn_loss": 0.23646180331707,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2324382085114291,
      "grad_norm": 0.5524564981460571,
      "learning_rate": 6.380728583418995e-06,
      "loss": 0.1535,
      "mae_dtheta": 0.015156700275838375,
      "mae_dx": 0.002499874448403716,
      "mae_dy": 0.0033200299367308617,
      "pose_mae_dtheta": 0.10390055179595947,
      "pose_mae_dx": 0.03584326058626175,
      "pose_mae_dy": 0.04376782849431038,
      "pose_rmse_dtheta": 0.21512427926063538,
      "pose_rmse_dx": 0.09517186880111694,
      "pose_rmse_dy": 0.10201851278543472,
      "pose_rmse_mean": 0.13743822276592255,
      "rmse_dtheta": 0.027548443526029587,
      "rmse_dx": 0.007822505198419094,
      "rmse_dy": 0.006720041856169701,
      "rmse_mean": 0.014030329883098602,
      "rotation_flip": 0.007039499469101429,
      "sparse_tokens": 32057.0,
      "step": 5003,
      "turn_loss": 0.12424106895923615,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.23248466827727188,
      "grad_norm": 0.3771854043006897,
      "learning_rate": 6.379457729485106e-06,
      "loss": 0.0981,
      "mae_dtheta": 0.036649446934461594,
      "mae_dx": 0.01205748412758112,
      "mae_dy": 0.009343265555799007,
      "pose_mae_dtheta": 0.27052974700927734,
      "pose_mae_dx": 0.10293282568454742,
      "pose_mae_dy": 0.09384218603372574,
      "pose_rmse_dtheta": 0.4610077738761902,
      "pose_rmse_dx": 0.21128183603286743,
      "pose_rmse_dy": 0.1960028111934662,
      "pose_rmse_mean": 0.2894308269023895,
      "rmse_dtheta": 0.054030098021030426,
      "rmse_dx": 0.023292016237974167,
      "rmse_dy": 0.018640009686350822,
      "rmse_mean": 0.031987376511096954,
      "rotation_flip": 0.017832648009061813,
      "sparse_tokens": 23526.0,
      "step": 5004,
      "turn_loss": 0.34886276721954346,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23253112804311465,
      "grad_norm": 0.4452718198299408,
      "learning_rate": 6.378186779084996e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.010624810121953487,
      "mae_dx": 0.0018844457808881998,
      "mae_dy": 0.0030279059428721666,
      "pose_mae_dtheta": 0.0722208172082901,
      "pose_mae_dx": 0.02557923085987568,
      "pose_mae_dy": 0.031647052615880966,
      "pose_rmse_dtheta": 0.18941918015480042,
      "pose_rmse_dx": 0.0672462210059166,
      "pose_rmse_dy": 0.06881381571292877,
      "pose_rmse_mean": 0.10849307477474213,
      "rmse_dtheta": 0.023335307836532593,
      "rmse_dx": 0.00517601054161787,
      "rmse_dy": 0.006373645272105932,
      "rmse_mean": 0.011628321371972561,
      "rotation_flip": 0.002768987324088812,
      "sparse_tokens": 32089.0,
      "step": 5005,
      "turn_loss": 0.08893806487321854,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16513.0,
      "epoch": 0.23257758780895743,
      "grad_norm": 0.3723302483558655,
      "learning_rate": 6.376915732307547e-06,
      "loss": 0.1118,
      "mae_dtheta": 0.034771889448165894,
      "mae_dx": 0.015468494035303593,
      "mae_dy": 0.0061264969408512115,
      "pose_mae_dtheta": 0.2902452349662781,
      "pose_mae_dx": 0.12205925583839417,
      "pose_mae_dy": 0.0992337316274643,
      "pose_rmse_dtheta": 0.5346925258636475,
      "pose_rmse_dx": 0.26994088292121887,
      "pose_rmse_dy": 0.22513696551322937,
      "pose_rmse_mean": 0.34325680136680603,
      "rmse_dtheta": 0.05348098650574684,
      "rmse_dx": 0.030145298689603806,
      "rmse_dy": 0.013084066100418568,
      "rmse_mean": 0.03223678469657898,
      "rotation_flip": 0.0172955971211195,
      "sparse_tokens": 13136.0,
      "step": 5006,
      "turn_loss": 0.25549250841140747,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 15220.0,
      "epoch": 0.23262404757480024,
      "grad_norm": 0.5634969472885132,
      "learning_rate": 6.375644589241641e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.04622955992817879,
      "mae_dx": 0.010541836731135845,
      "mae_dy": 0.003985346760600805,
      "pose_mae_dtheta": 0.4106873869895935,
      "pose_mae_dx": 0.09824512153863907,
      "pose_mae_dy": 0.031867291778326035,
      "pose_rmse_dtheta": 0.6938632726669312,
      "pose_rmse_dx": 0.21884454786777496,
      "pose_rmse_dy": 0.07742919772863388,
      "pose_rmse_mean": 0.3300456702709198,
      "rmse_dtheta": 0.0685659721493721,
      "rmse_dx": 0.02103794366121292,
      "rmse_dy": 0.01042346004396677,
      "rmse_mean": 0.03334245830774307,
      "rotation_flip": 0.012857142835855484,
      "sparse_tokens": 11698.0,
      "step": 5007,
      "turn_loss": 0.30553439259529114,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.232670507340643,
      "grad_norm": 0.37759929895401,
      "learning_rate": 6.374373349976169e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.010332508012652397,
      "mae_dx": 0.0013283607549965382,
      "mae_dy": 0.002394293202087283,
      "pose_mae_dtheta": 0.07160187512636185,
      "pose_mae_dx": 0.020448431372642517,
      "pose_mae_dy": 0.028153935447335243,
      "pose_rmse_dtheta": 0.18297795951366425,
      "pose_rmse_dx": 0.04877493903040886,
      "pose_rmse_dy": 0.061043236404657364,
      "pose_rmse_mean": 0.09759871661663055,
      "rmse_dtheta": 0.021852176636457443,
      "rmse_dx": 0.0039050146006047726,
      "rmse_dy": 0.004805680364370346,
      "rmse_mean": 0.010187624022364616,
      "rotation_flip": 0.009225091896951199,
      "sparse_tokens": 32073.0,
      "step": 5008,
      "turn_loss": 0.07844899594783783,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.2327169671064858,
      "grad_norm": 0.9834953546524048,
      "learning_rate": 6.373102014600033e-06,
      "loss": 0.275,
      "mae_dtheta": 0.04229246824979782,
      "mae_dx": 0.015409651212394238,
      "mae_dy": 0.004416720941662788,
      "pose_mae_dtheta": 0.38695675134658813,
      "pose_mae_dx": 0.12537163496017456,
      "pose_mae_dy": 0.04750625044107437,
      "pose_rmse_dtheta": 0.63857102394104,
      "pose_rmse_dx": 0.26764488220214844,
      "pose_rmse_dy": 0.11754079908132553,
      "pose_rmse_mean": 0.34125226736068726,
      "rmse_dtheta": 0.06211763992905617,
      "rmse_dx": 0.028915412724018097,
      "rmse_dy": 0.009022532030940056,
      "rmse_mean": 0.03335186466574669,
      "rotation_flip": 0.013559321872889996,
      "sparse_tokens": 8617.0,
      "step": 5009,
      "turn_loss": 0.34323760867118835,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.23276342687232857,
      "grad_norm": 0.4784921407699585,
      "learning_rate": 6.371830583202135e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.048366159200668335,
      "mae_dx": 0.024990180507302284,
      "mae_dy": 0.0069458140060305595,
      "pose_mae_dtheta": 0.36593687534332275,
      "pose_mae_dx": 0.19982044398784637,
      "pose_mae_dy": 0.07673177123069763,
      "pose_rmse_dtheta": 0.594539999961853,
      "pose_rmse_dx": 0.3786740005016327,
      "pose_rmse_dy": 0.16928035020828247,
      "pose_rmse_mean": 0.3808314800262451,
      "rmse_dtheta": 0.06943510472774506,
      "rmse_dx": 0.0390748530626297,
      "rmse_dy": 0.014482921920716763,
      "rmse_mean": 0.04099762812256813,
      "rotation_flip": 0.012903225608170033,
      "sparse_tokens": 4802.0,
      "step": 5010,
      "turn_loss": 0.30987513065338135,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.23280988663817134,
      "grad_norm": 0.5423675775527954,
      "learning_rate": 6.370559055871389e-06,
      "loss": 0.134,
      "mae_dtheta": 0.0371396467089653,
      "mae_dx": 0.009362920187413692,
      "mae_dy": 0.00566956028342247,
      "pose_mae_dtheta": 0.2888360321521759,
      "pose_mae_dx": 0.07519958913326263,
      "pose_mae_dy": 0.05294987931847572,
      "pose_rmse_dtheta": 0.4978026747703552,
      "pose_rmse_dx": 0.17578913271427155,
      "pose_rmse_dy": 0.11234044283628464,
      "pose_rmse_mean": 0.2619774341583252,
      "rmse_dtheta": 0.05481874942779541,
      "rmse_dx": 0.02107563614845276,
      "rmse_dy": 0.010866069234907627,
      "rmse_mean": 0.02892015129327774,
      "rotation_flip": 0.019258202984929085,
      "sparse_tokens": 21669.0,
      "step": 5011,
      "turn_loss": 0.29174676537513733,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23285634640401412,
      "grad_norm": 0.5028961896896362,
      "learning_rate": 6.369287432696713e-06,
      "loss": 0.1084,
      "mae_dtheta": 0.010415451601147652,
      "mae_dx": 0.002115509705618024,
      "mae_dy": 0.0021077878773212433,
      "pose_mae_dtheta": 0.07193416357040405,
      "pose_mae_dx": 0.024514244869351387,
      "pose_mae_dy": 0.027554864063858986,
      "pose_rmse_dtheta": 0.15920577943325043,
      "pose_rmse_dx": 0.057758644223213196,
      "pose_rmse_dy": 0.05956326797604561,
      "pose_rmse_mean": 0.09217590093612671,
      "rmse_dtheta": 0.022529123350977898,
      "rmse_dx": 0.006141444202512503,
      "rmse_dy": 0.0044150641188025475,
      "rmse_mean": 0.01102854497730732,
      "rotation_flip": 0.007413868326693773,
      "sparse_tokens": 32089.0,
      "step": 5012,
      "turn_loss": 0.08684200793504715,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.2329028061698569,
      "grad_norm": 0.6236593723297119,
      "learning_rate": 6.368015713767029e-06,
      "loss": 0.1544,
      "mae_dtheta": 0.03798573836684227,
      "mae_dx": 0.012021468952298164,
      "mae_dy": 0.009675045497715473,
      "pose_mae_dtheta": 0.33155032992362976,
      "pose_mae_dx": 0.08027899265289307,
      "pose_mae_dy": 0.07230506092309952,
      "pose_rmse_dtheta": 0.5354016423225403,
      "pose_rmse_dx": 0.17260205745697021,
      "pose_rmse_dy": 0.17724579572677612,
      "pose_rmse_mean": 0.2950831651687622,
      "rmse_dtheta": 0.05574949458241463,
      "rmse_dx": 0.022928576916456223,
      "rmse_dy": 0.019620995968580246,
      "rmse_mean": 0.03276635706424713,
      "rotation_flip": 0.009633911773562431,
      "sparse_tokens": 7665.0,
      "step": 5013,
      "turn_loss": 0.37451666593551636,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 19157.0,
      "epoch": 0.23294926593569967,
      "grad_norm": 0.413767546415329,
      "learning_rate": 6.366743899171274e-06,
      "loss": 0.0949,
      "mae_dtheta": 0.02170332707464695,
      "mae_dx": 0.009608742780983448,
      "mae_dy": 0.0034093516878783703,
      "pose_mae_dtheta": 0.17551469802856445,
      "pose_mae_dx": 0.07399484515190125,
      "pose_mae_dy": 0.03715405985713005,
      "pose_rmse_dtheta": 0.34604671597480774,
      "pose_rmse_dx": 0.17524294555187225,
      "pose_rmse_dy": 0.08313348144292831,
      "pose_rmse_mean": 0.2014743685722351,
      "rmse_dtheta": 0.03756604343652725,
      "rmse_dx": 0.020614881068468094,
      "rmse_dy": 0.006867471616715193,
      "rmse_mean": 0.021682798862457275,
      "rotation_flip": 0.023370234295725822,
      "sparse_tokens": 14581.0,
      "step": 5014,
      "turn_loss": 0.1659776121377945,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23299572570154248,
      "grad_norm": 0.3663344979286194,
      "learning_rate": 6.365471988998384e-06,
      "loss": 0.117,
      "mae_dtheta": 0.00857245922088623,
      "mae_dx": 0.0011733894934877753,
      "mae_dy": 0.002057924633845687,
      "pose_mae_dtheta": 0.05413307249546051,
      "pose_mae_dx": 0.022325823083519936,
      "pose_mae_dy": 0.02779199369251728,
      "pose_rmse_dtheta": 0.1039782240986824,
      "pose_rmse_dx": 0.05455218255519867,
      "pose_rmse_dy": 0.0598561130464077,
      "pose_rmse_mean": 0.07279551029205322,
      "rmse_dtheta": 0.016947917640209198,
      "rmse_dx": 0.0033030682243406773,
      "rmse_dy": 0.004062385763972998,
      "rmse_mean": 0.008104457519948483,
      "rotation_flip": 0.0019105846295133233,
      "sparse_tokens": 32089.0,
      "step": 5015,
      "turn_loss": 0.0675884261727333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23304218546738525,
      "grad_norm": 0.6308369040489197,
      "learning_rate": 6.364199983337306e-06,
      "loss": 0.1687,
      "mae_dtheta": 0.009379447437822819,
      "mae_dx": 0.0015458775451406837,
      "mae_dy": 0.0024696593172848225,
      "pose_mae_dtheta": 0.05887730419635773,
      "pose_mae_dx": 0.02125895582139492,
      "pose_mae_dy": 0.027332313358783722,
      "pose_rmse_dtheta": 0.1060049906373024,
      "pose_rmse_dx": 0.0484759584069252,
      "pose_rmse_dy": 0.05917854607105255,
      "pose_rmse_mean": 0.07121983170509338,
      "rmse_dtheta": 0.017851034179329872,
      "rmse_dx": 0.00416800519451499,
      "rmse_dy": 0.005101434420794249,
      "rmse_mean": 0.009040158241987228,
      "rotation_flip": 0.005217391531914473,
      "sparse_tokens": 32105.0,
      "step": 5016,
      "turn_loss": 0.08330295234918594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.23308864523322803,
      "grad_norm": 0.7194333076477051,
      "learning_rate": 6.362927882276991e-06,
      "loss": 0.131,
      "mae_dtheta": 0.033934276551008224,
      "mae_dx": 0.010121197439730167,
      "mae_dy": 0.007222078740596771,
      "pose_mae_dtheta": 0.2498808354139328,
      "pose_mae_dx": 0.07221779227256775,
      "pose_mae_dy": 0.0655876025557518,
      "pose_rmse_dtheta": 0.4500278830528259,
      "pose_rmse_dx": 0.16802771389484406,
      "pose_rmse_dy": 0.16125409305095673,
      "pose_rmse_mean": 0.25976991653442383,
      "rmse_dtheta": 0.052274029701948166,
      "rmse_dx": 0.02108079195022583,
      "rmse_dy": 0.01539816614240408,
      "rmse_mean": 0.029584331437945366,
      "rotation_flip": 0.013100436888635159,
      "sparse_tokens": 17468.0,
      "step": 5017,
      "turn_loss": 0.28974655270576477,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.2331351049990708,
      "grad_norm": 0.703465461730957,
      "learning_rate": 6.361655685906396e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.034144625067710876,
      "mae_dx": 0.010560397990047932,
      "mae_dy": 0.00727442791685462,
      "pose_mae_dtheta": 0.2757614254951477,
      "pose_mae_dx": 0.08719267696142197,
      "pose_mae_dy": 0.08817461133003235,
      "pose_rmse_dtheta": 0.47460609674453735,
      "pose_rmse_dx": 0.20031319558620453,
      "pose_rmse_dy": 0.19929097592830658,
      "pose_rmse_mean": 0.2914034426212311,
      "rmse_dtheta": 0.052514031529426575,
      "rmse_dx": 0.023945627734065056,
      "rmse_dy": 0.01676272600889206,
      "rmse_mean": 0.031074129045009613,
      "rotation_flip": 0.012500000186264515,
      "sparse_tokens": 9326.0,
      "step": 5018,
      "turn_loss": 0.28229770064353943,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.23318156476491358,
      "grad_norm": 0.37162917852401733,
      "learning_rate": 6.360383394314488e-06,
      "loss": 0.0981,
      "mae_dtheta": 0.03716892749071121,
      "mae_dx": 0.013380159623920918,
      "mae_dy": 0.012570257298648357,
      "pose_mae_dtheta": 0.26738840341567993,
      "pose_mae_dx": 0.12134217470884323,
      "pose_mae_dy": 0.12353932857513428,
      "pose_rmse_dtheta": 0.4543211758136749,
      "pose_rmse_dx": 0.25150567293167114,
      "pose_rmse_dy": 0.32874298095703125,
      "pose_rmse_mean": 0.3448566198348999,
      "rmse_dtheta": 0.055439431220293045,
      "rmse_dx": 0.025883954018354416,
      "rmse_dy": 0.028395652770996094,
      "rmse_mean": 0.03657301515340805,
      "rotation_flip": 0.019851116463541985,
      "sparse_tokens": 6704.0,
      "step": 5019,
      "turn_loss": 0.46454256772994995,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 19744.0,
      "epoch": 0.23322802453075636,
      "grad_norm": 0.37194201350212097,
      "learning_rate": 6.359111007590239e-06,
      "loss": 0.12,
      "mae_dtheta": 0.035472821444272995,
      "mae_dx": 0.014240882359445095,
      "mae_dy": 0.004119392018765211,
      "pose_mae_dtheta": 0.298203706741333,
      "pose_mae_dx": 0.12283065170049667,
      "pose_mae_dy": 0.049051929265260696,
      "pose_rmse_dtheta": 0.5133105516433716,
      "pose_rmse_dx": 0.2528148591518402,
      "pose_rmse_dy": 0.12341538071632385,
      "pose_rmse_mean": 0.2965136170387268,
      "rmse_dtheta": 0.053763050585985184,
      "rmse_dx": 0.02693713642656803,
      "rmse_dy": 0.008128909394145012,
      "rmse_mean": 0.02960970066487789,
      "rotation_flip": 0.018378378823399544,
      "sparse_tokens": 15551.0,
      "step": 5020,
      "turn_loss": 0.27128562331199646,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.23327448429659914,
      "grad_norm": 0.4688222110271454,
      "learning_rate": 6.357838525822629e-06,
      "loss": 0.1006,
      "mae_dtheta": 0.014195997267961502,
      "mae_dx": 0.004180465824902058,
      "mae_dy": 0.005381165537983179,
      "pose_mae_dtheta": 0.09060746431350708,
      "pose_mae_dx": 0.047230154275894165,
      "pose_mae_dy": 0.04561006277799606,
      "pose_rmse_dtheta": 0.18522551655769348,
      "pose_rmse_dx": 0.12315218895673752,
      "pose_rmse_dy": 0.0975889042019844,
      "pose_rmse_mean": 0.1353222131729126,
      "rmse_dtheta": 0.026583237573504448,
      "rmse_dx": 0.01142452098429203,
      "rmse_dy": 0.0112196896225214,
      "rmse_mean": 0.016409149393439293,
      "rotation_flip": 0.008828522637486458,
      "sparse_tokens": 32073.0,
      "step": 5021,
      "turn_loss": 0.16754142940044403,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.23332094406244192,
      "grad_norm": 0.5682930946350098,
      "learning_rate": 6.356565949100642e-06,
      "loss": 0.1732,
      "mae_dtheta": 0.035026758909225464,
      "mae_dx": 0.01286478340625763,
      "mae_dy": 0.004374321084469557,
      "pose_mae_dtheta": 0.2765219509601593,
      "pose_mae_dx": 0.09475697576999664,
      "pose_mae_dy": 0.040127769112586975,
      "pose_rmse_dtheta": 0.4730207324028015,
      "pose_rmse_dx": 0.20682945847511292,
      "pose_rmse_dy": 0.08289004862308502,
      "pose_rmse_mean": 0.2542467713356018,
      "rmse_dtheta": 0.05158863216638565,
      "rmse_dx": 0.025363309308886528,
      "rmse_dy": 0.008511209860444069,
      "rmse_mean": 0.028487717732787132,
      "rotation_flip": 0.023977432399988174,
      "sparse_tokens": 11370.0,
      "step": 5022,
      "turn_loss": 0.28163039684295654,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.2333674038282847,
      "grad_norm": 0.6734012961387634,
      "learning_rate": 6.355293277513271e-06,
      "loss": 0.1637,
      "mae_dtheta": 0.02466927282512188,
      "mae_dx": 0.010247215628623962,
      "mae_dy": 0.005064073950052261,
      "pose_mae_dtheta": 0.19608843326568604,
      "pose_mae_dx": 0.07820257544517517,
      "pose_mae_dy": 0.0505799762904644,
      "pose_rmse_dtheta": 0.3385560214519501,
      "pose_rmse_dx": 0.1740056723356247,
      "pose_rmse_dy": 0.1096326932311058,
      "pose_rmse_mean": 0.20739811658859253,
      "rmse_dtheta": 0.04105382785201073,
      "rmse_dx": 0.022443396970629692,
      "rmse_dy": 0.010103439912199974,
      "rmse_mean": 0.024533554911613464,
      "rotation_flip": 0.013452914543449879,
      "sparse_tokens": 7295.0,
      "step": 5023,
      "turn_loss": 0.26868870854377747,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2334138635941275,
      "grad_norm": 0.5081350803375244,
      "learning_rate": 6.354020511149512e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.008342270739376545,
      "mae_dx": 0.001346064847894013,
      "mae_dy": 0.0010982562089338899,
      "pose_mae_dtheta": 0.05507950857281685,
      "pose_mae_dx": 0.012478436343371868,
      "pose_mae_dy": 0.016355572268366814,
      "pose_rmse_dtheta": 0.18320970237255096,
      "pose_rmse_dx": 0.03545374795794487,
      "pose_rmse_dy": 0.042941462248563766,
      "pose_rmse_mean": 0.08720164000988007,
      "rmse_dtheta": 0.024437637999653816,
      "rmse_dx": 0.004230765160173178,
      "rmse_dy": 0.0023556428495794535,
      "rmse_mean": 0.010341349057853222,
      "rotation_flip": 0.001752848387695849,
      "sparse_tokens": 32153.0,
      "step": 5024,
      "turn_loss": 0.05260975658893585,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23346032335997027,
      "grad_norm": 0.4343988001346588,
      "learning_rate": 6.352747650098373e-06,
      "loss": 0.1212,
      "mae_dtheta": 0.0076386635191738605,
      "mae_dx": 0.0016513756709173322,
      "mae_dy": 0.0011331557761877775,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4343988597393036,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 167.3469696044922,
      "model/head/act_norm_mean": 133.36075599747474,
      "model/head/act_norm_min": 56.65536117553711,
      "model/head/act_over_embed": 91.64676006453341,
      "model/head/grad_frac": 0.11315257847309113,
      "model/head/grad_norm": 0.04915335029363632,
      "model/head/grad_zero_frac": 0.00014340683992486447,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6908094618055556,
      "model/head/update_ratio": 0.0008418777724727988,
      "model/head/weight_delta": 8.308298110961914,
      "model/head/weight_delta_rel": 0.1457521617412567,
      "model/head/weight_norm": 58.3853759765625,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.41999953985214233,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41991438245559487,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41985028982162476,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.288569094923872,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09055805206298828,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03933831304311752,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.545377312219731,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012725049164146185,
      "model/modality_embedder.encoders.pose/weight_delta": 2.7218217849731445,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0889303982257843,
      "model/modality_embedder.encoders.pose/weight_norm": 30.91407585144043,
      "model/modality_embedder/grad_frac": 0.09055805206298828,
      "model/modality_embedder/grad_norm": 0.03933831304311752,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.545377312219731,
      "model/modality_embedder/update_ratio": 0.0012725049164146185,
      "model/modality_embedder/weight_delta": 2.7218217849731445,
      "model/modality_embedder/weight_delta_rel": 0.0889303982257843,
      "model/modality_embedder/weight_norm": 30.91407585144043,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 93.22235107421875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.831947951739618,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.045113563537598,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.75195647494248,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0948123186826706,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.041186362504959106,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001480928505770862,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.046349287033081,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0745702013373375,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.811176300048828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 94.54528045654297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.89466339987173,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.170056343078613,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.48226448019765,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09060374647378922,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03935816511511803,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013330961810424924,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.5922868251800537,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.08979884535074234,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.523874282836914,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 96.20191955566406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.736471861471863,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.202018737792969,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.747972498291748,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09075584262609482,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03942423313856125,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012934701517224312,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.7890799045562744,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09365208446979523,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.47943115234375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.844970703125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 30.412262506012507,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.39818286895752,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.899591518219278,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09678778052330017,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0420445017516613,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014128186739981174,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.3792738914489746,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08131229132413864,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.759305953979492,
      "model/normalizer/grad_frac": 0.38400205969810486,
      "model/normalizer/grad_norm": 0.1668100506067276,
      "model/normalizer/grad_zero_frac": 0.00014535382797475904,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021282038651406765,
      "model/normalizer/weight_delta": 5.049393653869629,
      "model/normalizer/weight_delta_rel": 0.06503326445817947,
      "model/normalizer/weight_norm": 78.38066864013672,
      "pose_mae_dtheta": 0.05706842243671417,
      "pose_mae_dx": 0.016702022403478622,
      "pose_mae_dy": 0.012616635300219059,
      "pose_rmse_dtheta": 0.22587715089321136,
      "pose_rmse_dx": 0.049912966787815094,
      "pose_rmse_dy": 0.04781042039394379,
      "pose_rmse_mean": 0.10786684602499008,
      "rmse_dtheta": 0.025332588702440262,
      "rmse_dx": 0.005371824372559786,
      "rmse_dy": 0.004330373369157314,
      "rmse_mean": 0.011678262613713741,
      "rotation_flip": 0.0,
      "sparse_tokens": 32105.0,
      "step": 5025,
      "turn_loss": 0.062370508909225464,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23350678312581305,
      "grad_norm": 0.6296175122261047,
      "learning_rate": 6.351474694448865e-06,
      "loss": 0.168,
      "mae_dtheta": 0.011427816934883595,
      "mae_dx": 0.0017571443459019065,
      "mae_dy": 0.002224466996267438,
      "pose_mae_dtheta": 0.07837030291557312,
      "pose_mae_dx": 0.02093764767050743,
      "pose_mae_dy": 0.028394345194101334,
      "pose_rmse_dtheta": 0.20350222289562225,
      "pose_rmse_dx": 0.06046261265873909,
      "pose_rmse_dy": 0.06231223791837692,
      "pose_rmse_mean": 0.10875903069972992,
      "rmse_dtheta": 0.025638803839683533,
      "rmse_dx": 0.005305234808474779,
      "rmse_dy": 0.005852214526385069,
      "rmse_mean": 0.012265417724847794,
      "rotation_flip": 0.005078290123492479,
      "sparse_tokens": 32089.0,
      "step": 5026,
      "turn_loss": 0.08444482833147049,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23355324289165583,
      "grad_norm": 0.4722146689891815,
      "learning_rate": 6.350201644290005e-06,
      "loss": 0.087,
      "mae_dtheta": 0.008781377226114273,
      "mae_dx": 0.0026159402914345264,
      "mae_dy": 0.0028697180096060038,
      "pose_mae_dtheta": 0.05731138214468956,
      "pose_mae_dx": 0.0263533852994442,
      "pose_mae_dy": 0.025822486728429794,
      "pose_rmse_dtheta": 0.1413576304912567,
      "pose_rmse_dx": 0.09106165170669556,
      "pose_rmse_dy": 0.06904193013906479,
      "pose_rmse_mean": 0.10048707574605942,
      "rmse_dtheta": 0.020266667008399963,
      "rmse_dx": 0.009889822453260422,
      "rmse_dy": 0.008416643366217613,
      "rmse_mean": 0.012857710942626,
      "rotation_flip": 0.0051701851189136505,
      "sparse_tokens": 32089.0,
      "step": 5027,
      "turn_loss": 0.07527433335781097,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2335997026574986,
      "grad_norm": 0.6292029023170471,
      "learning_rate": 6.34892849971082e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.012544030323624611,
      "mae_dx": 0.002313657896593213,
      "mae_dy": 0.0026971071492880583,
      "pose_mae_dtheta": 0.08666294813156128,
      "pose_mae_dx": 0.031615570187568665,
      "pose_mae_dy": 0.03568717837333679,
      "pose_rmse_dtheta": 0.18843640387058258,
      "pose_rmse_dx": 0.07197269052267075,
      "pose_rmse_dy": 0.07734119147062302,
      "pose_rmse_mean": 0.11258342862129211,
      "rmse_dtheta": 0.02495926432311535,
      "rmse_dx": 0.006223565433174372,
      "rmse_dy": 0.005324872676283121,
      "rmse_mean": 0.012169234454631805,
      "rotation_flip": 0.0070469798520207405,
      "sparse_tokens": 32169.0,
      "step": 5028,
      "turn_loss": 0.1026521772146225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.23364616242334138,
      "grad_norm": 0.3609292805194855,
      "learning_rate": 6.34765526080034e-06,
      "loss": 0.0702,
      "mae_dtheta": 0.030430873855948448,
      "mae_dx": 0.005550784058868885,
      "mae_dy": 0.00449391221627593,
      "pose_mae_dtheta": 0.23028936982154846,
      "pose_mae_dx": 0.05680790916085243,
      "pose_mae_dy": 0.06537197530269623,
      "pose_rmse_dtheta": 0.36022302508354187,
      "pose_rmse_dx": 0.1261577010154724,
      "pose_rmse_dy": 0.12751415371894836,
      "pose_rmse_mean": 0.20463162660598755,
      "rmse_dtheta": 0.04376823827624321,
      "rmse_dx": 0.013613699935376644,
      "rmse_dy": 0.0075861793011426926,
      "rmse_mean": 0.021656040102243423,
      "rotation_flip": 0.005571030545979738,
      "sparse_tokens": 6183.0,
      "step": 5029,
      "turn_loss": 0.23493924736976624,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 32338.0,
      "epoch": 0.23369262218918416,
      "grad_norm": 0.534887433052063,
      "learning_rate": 6.346381927647606e-06,
      "loss": 0.1794,
      "mae_dtheta": 0.03774513676762581,
      "mae_dx": 0.015813816338777542,
      "mae_dy": 0.005116999614983797,
      "pose_mae_dtheta": 0.3039492666721344,
      "pose_mae_dx": 0.13432377576828003,
      "pose_mae_dy": 0.06310811638832092,
      "pose_rmse_dtheta": 0.5355674028396606,
      "pose_rmse_dx": 0.285140722990036,
      "pose_rmse_dy": 0.12221363931894302,
      "pose_rmse_mean": 0.3143072724342346,
      "rmse_dtheta": 0.055402323603630066,
      "rmse_dx": 0.029353614896535873,
      "rmse_dy": 0.0087243327870965,
      "rmse_mean": 0.03116009198129177,
      "rotation_flip": 0.00918079074472189,
      "sparse_tokens": 24857.0,
      "step": 5030,
      "turn_loss": 0.2834324538707733,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.23373908195502693,
      "grad_norm": 0.8510875105857849,
      "learning_rate": 6.3451085003416604e-06,
      "loss": 0.2348,
      "mae_dtheta": 0.03246814012527466,
      "mae_dx": 0.008030965924263,
      "mae_dy": 0.002061103703454137,
      "pose_mae_dtheta": 0.22149540483951569,
      "pose_mae_dx": 0.052011121064424515,
      "pose_mae_dy": 0.035074587911367416,
      "pose_rmse_dtheta": 0.4367445111274719,
      "pose_rmse_dx": 0.11598243564367294,
      "pose_rmse_dy": 0.09630090743303299,
      "pose_rmse_mean": 0.21634261310100555,
      "rmse_dtheta": 0.05601973086595535,
      "rmse_dx": 0.017810838297009468,
      "rmse_dy": 0.004456481896340847,
      "rmse_mean": 0.026095684617757797,
      "rotation_flip": 0.009287925437092781,
      "sparse_tokens": 5800.0,
      "step": 5031,
      "turn_loss": 0.20626714825630188,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 15868.0,
      "epoch": 0.23378554172086974,
      "grad_norm": 0.539181113243103,
      "learning_rate": 6.343834978971553e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.03562779724597931,
      "mae_dx": 0.00992216169834137,
      "mae_dy": 0.004218291491270065,
      "pose_mae_dtheta": 0.2990609407424927,
      "pose_mae_dx": 0.08524966239929199,
      "pose_mae_dy": 0.0432552695274353,
      "pose_rmse_dtheta": 0.552121102809906,
      "pose_rmse_dx": 0.22614745795726776,
      "pose_rmse_dy": 0.08620895445346832,
      "pose_rmse_mean": 0.28815919160842896,
      "rmse_dtheta": 0.055395159870386124,
      "rmse_dx": 0.02257869578897953,
      "rmse_dy": 0.007355390582233667,
      "rmse_mean": 0.02844308316707611,
      "rotation_flip": 0.014556040987372398,
      "sparse_tokens": 12537.0,
      "step": 5032,
      "turn_loss": 0.2653915286064148,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.23383200148671252,
      "grad_norm": 0.5549982786178589,
      "learning_rate": 6.342561363626348e-06,
      "loss": 0.1517,
      "mae_dtheta": 0.027447864413261414,
      "mae_dx": 0.01038199383765459,
      "mae_dy": 0.002720294753089547,
      "pose_mae_dtheta": 0.2039460390806198,
      "pose_mae_dx": 0.08495955914258957,
      "pose_mae_dy": 0.037075381726026535,
      "pose_rmse_dtheta": 0.41130197048187256,
      "pose_rmse_dx": 0.2204972356557846,
      "pose_rmse_dy": 0.07406245172023773,
      "pose_rmse_mean": 0.23528723418712616,
      "rmse_dtheta": 0.04485442861914635,
      "rmse_dx": 0.02407364547252655,
      "rmse_dy": 0.0048456816002726555,
      "rmse_mean": 0.024591252207756042,
      "rotation_flip": 0.013368983753025532,
      "sparse_tokens": 8377.0,
      "step": 5033,
      "turn_loss": 0.143475741147995,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 20710.0,
      "epoch": 0.2338784612525553,
      "grad_norm": 0.7079452872276306,
      "learning_rate": 6.341287654395104e-06,
      "loss": 0.1577,
      "mae_dtheta": 0.03143111988902092,
      "mae_dx": 0.01042366772890091,
      "mae_dy": 0.002909814938902855,
      "pose_mae_dtheta": 0.24810890853405,
      "pose_mae_dx": 0.07424014061689377,
      "pose_mae_dy": 0.03584558144211769,
      "pose_rmse_dtheta": 0.4390050768852234,
      "pose_rmse_dx": 0.16161885857582092,
      "pose_rmse_dy": 0.07367885857820511,
      "pose_rmse_mean": 0.22476761043071747,
      "rmse_dtheta": 0.0489281564950943,
      "rmse_dx": 0.020513515919446945,
      "rmse_dy": 0.006089598871767521,
      "rmse_mean": 0.025177091360092163,
      "rotation_flip": 0.012485811486840248,
      "sparse_tokens": 16020.0,
      "step": 5034,
      "turn_loss": 0.23112612962722778,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.23392492101839807,
      "grad_norm": 0.26678788661956787,
      "learning_rate": 6.3400138513668955e-06,
      "loss": 0.0507,
      "mae_dtheta": 0.006272268947213888,
      "mae_dx": 0.0011713785352185369,
      "mae_dy": 0.000730815576389432,
      "pose_mae_dtheta": 0.041092198342084885,
      "pose_mae_dx": 0.011473113670945168,
      "pose_mae_dy": 0.00914330966770649,
      "pose_rmse_dtheta": 0.1737884283065796,
      "pose_rmse_dx": 0.025561973452568054,
      "pose_rmse_dy": 0.021252131089568138,
      "pose_rmse_mean": 0.07353417575359344,
      "rmse_dtheta": 0.02280861884355545,
      "rmse_dx": 0.0033911806531250477,
      "rmse_dy": 0.0017943806014955044,
      "rmse_mean": 0.009331393986940384,
      "rotation_flip": 0.001580611220560968,
      "sparse_tokens": 32153.0,
      "step": 5035,
      "turn_loss": 0.0448465459048748,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23397138078424085,
      "grad_norm": 0.493434339761734,
      "learning_rate": 6.3387399546308e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.009152725338935852,
      "mae_dx": 0.001553068868815899,
      "mae_dy": 0.0016973554156720638,
      "pose_mae_dtheta": 0.06649123877286911,
      "pose_mae_dx": 0.019592123106122017,
      "pose_mae_dy": 0.02791418880224228,
      "pose_rmse_dtheta": 0.14352139830589294,
      "pose_rmse_dx": 0.04650729149580002,
      "pose_rmse_dy": 0.0717892050743103,
      "pose_rmse_mean": 0.08727263659238815,
      "rmse_dtheta": 0.019315138459205627,
      "rmse_dx": 0.005274485796689987,
      "rmse_dy": 0.003385702380910516,
      "rmse_mean": 0.009325109422206879,
      "rotation_flip": 0.0042087542824447155,
      "sparse_tokens": 32089.0,
      "step": 5036,
      "turn_loss": 0.07111726701259613,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.23401784055008362,
      "grad_norm": 0.4355029761791229,
      "learning_rate": 6.337465964275899e-06,
      "loss": 0.0918,
      "mae_dtheta": 0.03243692219257355,
      "mae_dx": 0.013275421224534512,
      "mae_dy": 0.0022766513284295797,
      "pose_mae_dtheta": 0.23686696588993073,
      "pose_mae_dx": 0.0953909158706665,
      "pose_mae_dy": 0.04140753671526909,
      "pose_rmse_dtheta": 0.45626240968704224,
      "pose_rmse_dx": 0.24685057997703552,
      "pose_rmse_dy": 0.10402845591306686,
      "pose_rmse_mean": 0.2690471410751343,
      "rmse_dtheta": 0.05227668210864067,
      "rmse_dx": 0.026994263753294945,
      "rmse_dy": 0.00454935897141695,
      "rmse_mean": 0.02794010192155838,
      "rotation_flip": 0.021459227427840233,
      "sparse_tokens": 4780.0,
      "step": 5037,
      "turn_loss": 0.2582035958766937,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2340643003159264,
      "grad_norm": 0.5618107318878174,
      "learning_rate": 6.336191880391285e-06,
      "loss": 0.1486,
      "mae_dtheta": 0.012763343751430511,
      "mae_dx": 0.002805710071697831,
      "mae_dy": 0.00481488136574626,
      "pose_mae_dtheta": 0.09140339493751526,
      "pose_mae_dx": 0.0364832766354084,
      "pose_mae_dy": 0.04189588129520416,
      "pose_rmse_dtheta": 0.17420145869255066,
      "pose_rmse_dx": 0.08742021769285202,
      "pose_rmse_dy": 0.0947098359465599,
      "pose_rmse_mean": 0.11877717822790146,
      "rmse_dtheta": 0.02402692846953869,
      "rmse_dx": 0.006903461180627346,
      "rmse_dy": 0.009167032316327095,
      "rmse_mean": 0.013365807943046093,
      "rotation_flip": 0.005425568204373121,
      "sparse_tokens": 32121.0,
      "step": 5038,
      "turn_loss": 0.13637247681617737,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.23411076008176918,
      "grad_norm": 0.9742370247840881,
      "learning_rate": 6.3349177030660555e-06,
      "loss": 0.2131,
      "mae_dtheta": 0.023186424747109413,
      "mae_dx": 0.014380238018929958,
      "mae_dy": 0.003613188397139311,
      "pose_mae_dtheta": 0.17827720940113068,
      "pose_mae_dx": 0.11920426785945892,
      "pose_mae_dy": 0.05550682172179222,
      "pose_rmse_dtheta": 0.3557553291320801,
      "pose_rmse_dx": 0.2810876965522766,
      "pose_rmse_dy": 0.14097528159618378,
      "pose_rmse_mean": 0.2592727839946747,
      "rmse_dtheta": 0.03889435902237892,
      "rmse_dx": 0.028900209814310074,
      "rmse_dy": 0.0067214928567409515,
      "rmse_mean": 0.024838685989379883,
      "rotation_flip": 0.005836575757712126,
      "sparse_tokens": 11072.0,
      "step": 5039,
      "turn_loss": 0.18907874822616577,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 32114.0,
      "epoch": 0.23415721984761198,
      "grad_norm": 0.6278553009033203,
      "learning_rate": 6.333643432389316e-06,
      "loss": 0.1369,
      "mae_dtheta": 0.03391725942492485,
      "mae_dx": 0.011651597917079926,
      "mae_dy": 0.004840485285967588,
      "pose_mae_dtheta": 0.24890857934951782,
      "pose_mae_dx": 0.08776909112930298,
      "pose_mae_dy": 0.05769835412502289,
      "pose_rmse_dtheta": 0.43934622406959534,
      "pose_rmse_dx": 0.20566651225090027,
      "pose_rmse_dy": 0.14756324887275696,
      "pose_rmse_mean": 0.26419198513031006,
      "rmse_dtheta": 0.050811730325222015,
      "rmse_dx": 0.023823881521821022,
      "rmse_dy": 0.01059006154537201,
      "rmse_mean": 0.028408557176589966,
      "rotation_flip": 0.007594936527311802,
      "sparse_tokens": 27436.0,
      "step": 5040,
      "turn_loss": 0.251220166683197,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 2946.0,
      "epoch": 0.23420367961345476,
      "grad_norm": 0.5665855407714844,
      "learning_rate": 6.332369068450175e-06,
      "loss": 0.1368,
      "mae_dtheta": 0.06957040727138519,
      "mae_dx": 0.021676216274499893,
      "mae_dy": 0.031506069004535675,
      "pose_mae_dtheta": 0.6549423933029175,
      "pose_mae_dx": 0.23042041063308716,
      "pose_mae_dy": 0.2339949607849121,
      "pose_rmse_dtheta": 0.9109796285629272,
      "pose_rmse_dx": 0.4012172520160675,
      "pose_rmse_dy": 0.39370959997177124,
      "pose_rmse_mean": 0.5686354637145996,
      "rmse_dtheta": 0.08696630597114563,
      "rmse_dx": 0.031673893332481384,
      "rmse_dy": 0.04400831460952759,
      "rmse_mean": 0.0542161725461483,
      "rotation_flip": 0.03896103799343109,
      "sparse_tokens": 2672.0,
      "step": 5041,
      "turn_loss": 0.7601354122161865,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23425013937929753,
      "grad_norm": 0.5029179453849792,
      "learning_rate": 6.3310946113377504e-06,
      "loss": 0.104,
      "mae_dtheta": 0.01209328230470419,
      "mae_dx": 0.001598792732693255,
      "mae_dy": 0.002292761579155922,
      "pose_mae_dtheta": 0.0829034224152565,
      "pose_mae_dx": 0.023973142728209496,
      "pose_mae_dy": 0.031264934688806534,
      "pose_rmse_dtheta": 0.1915246993303299,
      "pose_rmse_dx": 0.05776597931981087,
      "pose_rmse_dy": 0.07061027735471725,
      "pose_rmse_mean": 0.10663365572690964,
      "rmse_dtheta": 0.024517985060811043,
      "rmse_dx": 0.004356080200523138,
      "rmse_dy": 0.0047042109072208405,
      "rmse_mean": 0.01119275949895382,
      "rotation_flip": 0.0026565464213490486,
      "sparse_tokens": 32089.0,
      "step": 5042,
      "turn_loss": 0.09222593158483505,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.2342965991451403,
      "grad_norm": 0.5307959318161011,
      "learning_rate": 6.3298200611411654e-06,
      "loss": 0.1426,
      "mae_dtheta": 0.03003295697271824,
      "mae_dx": 0.010075414553284645,
      "mae_dy": 0.0032023494131863117,
      "pose_mae_dtheta": 0.22435377538204193,
      "pose_mae_dx": 0.07165852189064026,
      "pose_mae_dy": 0.030107460916042328,
      "pose_rmse_dtheta": 0.4209887683391571,
      "pose_rmse_dx": 0.14964377880096436,
      "pose_rmse_dy": 0.07475592941045761,
      "pose_rmse_mean": 0.21512949466705322,
      "rmse_dtheta": 0.049870576709508896,
      "rmse_dx": 0.020770272240042686,
      "rmse_dy": 0.007967500947415829,
      "rmse_mean": 0.02620278298854828,
      "rotation_flip": 0.012738853693008423,
      "sparse_tokens": 13363.0,
      "step": 5043,
      "turn_loss": 0.20878155529499054,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.2343430589109831,
      "grad_norm": 0.6900304555892944,
      "learning_rate": 6.328545417949549e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.005821269005537033,
      "mae_dx": 0.0013823200715705752,
      "mae_dy": 0.00025866366922855377,
      "pose_mae_dtheta": 0.04392469301819801,
      "pose_mae_dx": 0.012402107007801533,
      "pose_mae_dy": 0.003136712359264493,
      "pose_rmse_dtheta": 0.22431035339832306,
      "pose_rmse_dx": 0.028032811358571053,
      "pose_rmse_dy": 0.005432440899312496,
      "pose_rmse_mean": 0.08592520654201508,
      "rmse_dtheta": 0.024784281849861145,
      "rmse_dx": 0.003869373118504882,
      "rmse_dy": 0.0005739626940339804,
      "rmse_mean": 0.009742539376020432,
      "rotation_flip": 0.0017361111240461469,
      "sparse_tokens": 32233.0,
      "step": 5044,
      "turn_loss": 0.047509707510471344,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.23438951867682586,
      "grad_norm": 0.5791729688644409,
      "learning_rate": 6.327270681852038e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.004735184367746115,
      "mae_dx": 0.004890408832579851,
      "mae_dy": 0.0002983910671900958,
      "pose_mae_dtheta": 0.03653336688876152,
      "pose_mae_dx": 0.0427192859351635,
      "pose_mae_dy": 0.004577700514346361,
      "pose_rmse_dtheta": 0.1553235799074173,
      "pose_rmse_dx": 0.1756417453289032,
      "pose_rmse_dy": 0.008737313561141491,
      "pose_rmse_mean": 0.11323422193527222,
      "rmse_dtheta": 0.01736646145582199,
      "rmse_dx": 0.01695437729358673,
      "rmse_dy": 0.0005661303293891251,
      "rmse_mean": 0.01162898913025856,
      "rotation_flip": 0.0,
      "sparse_tokens": 32041.0,
      "step": 5045,
      "turn_loss": 0.04826140031218529,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.23443597844266864,
      "grad_norm": 0.5976676344871521,
      "learning_rate": 6.325995852937776e-06,
      "loss": 0.1267,
      "mae_dtheta": 0.035314951092004776,
      "mae_dx": 0.010842084884643555,
      "mae_dy": 0.00340663711540401,
      "pose_mae_dtheta": 0.25846585631370544,
      "pose_mae_dx": 0.091007299721241,
      "pose_mae_dy": 0.036152686923742294,
      "pose_rmse_dtheta": 0.49691420793533325,
      "pose_rmse_dx": 0.21693265438079834,
      "pose_rmse_dy": 0.07903356105089188,
      "pose_rmse_mean": 0.26429349184036255,
      "rmse_dtheta": 0.05453446879982948,
      "rmse_dx": 0.022122478112578392,
      "rmse_dy": 0.0075389607809484005,
      "rmse_mean": 0.028065301477909088,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 9347.0,
      "step": 5046,
      "turn_loss": 0.2782415747642517,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.23448243820851142,
      "grad_norm": 0.6686236262321472,
      "learning_rate": 6.324720931295913e-06,
      "loss": 0.1901,
      "mae_dtheta": 0.02498663030564785,
      "mae_dx": 0.011740881949663162,
      "mae_dy": 0.003623067634180188,
      "pose_mae_dtheta": 0.2100275307893753,
      "pose_mae_dx": 0.104214146733284,
      "pose_mae_dy": 0.03473219275474548,
      "pose_rmse_dtheta": 0.3155798017978668,
      "pose_rmse_dx": 0.20380085706710815,
      "pose_rmse_dy": 0.07016295939683914,
      "pose_rmse_mean": 0.1965145468711853,
      "rmse_dtheta": 0.03770194575190544,
      "rmse_dx": 0.02339502051472664,
      "rmse_dy": 0.006264667492359877,
      "rmse_mean": 0.022453878074884415,
      "rotation_flip": 0.019417475908994675,
      "sparse_tokens": 3724.0,
      "step": 5047,
      "turn_loss": 0.2958360016345978,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.23452889797435422,
      "grad_norm": 0.37629833817481995,
      "learning_rate": 6.323445917015605e-06,
      "loss": 0.0876,
      "mae_dtheta": 0.03213890641927719,
      "mae_dx": 0.015101701952517033,
      "mae_dy": 0.002997360657900572,
      "pose_mae_dtheta": 0.29510489106178284,
      "pose_mae_dx": 0.11250068992376328,
      "pose_mae_dy": 0.04287254437804222,
      "pose_rmse_dtheta": 0.5078117847442627,
      "pose_rmse_dx": 0.2446792721748352,
      "pose_rmse_dy": 0.13174155354499817,
      "pose_rmse_mean": 0.29474422335624695,
      "rmse_dtheta": 0.04999749734997749,
      "rmse_dx": 0.028327716514468193,
      "rmse_dy": 0.007345013786107302,
      "rmse_mean": 0.028556741774082184,
      "rotation_flip": 0.014999999664723873,
      "sparse_tokens": 15759.0,
      "step": 5048,
      "turn_loss": 0.2695939540863037,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.234575357740197,
      "grad_norm": 0.5421497821807861,
      "learning_rate": 6.322170810186013e-06,
      "loss": 0.1177,
      "mae_dtheta": 0.031086817383766174,
      "mae_dx": 0.011540504172444344,
      "mae_dy": 0.002425349084660411,
      "pose_mae_dtheta": 0.22988681495189667,
      "pose_mae_dx": 0.09038855135440826,
      "pose_mae_dy": 0.021101979538798332,
      "pose_rmse_dtheta": 0.4177117645740509,
      "pose_rmse_dx": 0.23200437426567078,
      "pose_rmse_dy": 0.053234077990055084,
      "pose_rmse_mean": 0.23431675136089325,
      "rmse_dtheta": 0.048093367367982864,
      "rmse_dx": 0.024794960394501686,
      "rmse_dy": 0.005905396770685911,
      "rmse_mean": 0.026264576241374016,
      "rotation_flip": 0.006561679765582085,
      "sparse_tokens": 15493.0,
      "step": 5049,
      "turn_loss": 0.23154374957084656,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.23462181750603978,
      "grad_norm": 0.5185896158218384,
      "learning_rate": 6.320895610896305e-06,
      "loss": 0.1187,
      "mae_dtheta": 0.033813636749982834,
      "mae_dx": 0.009708302095532417,
      "mae_dy": 0.005282965954393148,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5185897946357727,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.6204376220703,
      "model/head/act_norm_mean": 110.84129423253677,
      "model/head/act_norm_min": 72.06405639648438,
      "model/head/act_over_embed": 76.1711751091453,
      "model/head/grad_frac": 0.10427720099687576,
      "model/head/grad_norm": 0.05407709255814552,
      "model/head/grad_zero_frac": 0.00018084491603076458,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6882180606617647,
      "model/head/update_ratio": 0.0009261277737095952,
      "model/head/weight_delta": 8.326447486877441,
      "model/head/weight_delta_rel": 0.14607055485248566,
      "model/head/weight_norm": 58.39052963256836,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4199247360229492,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.41987969534737724,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41982364654541016,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28854525761835903,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1063314825296402,
      "model/modality_embedder.encoders.pose/grad_norm": 0.055142421275377274,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5438616071428571,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017836865736171603,
      "model/modality_embedder.encoders.pose/weight_delta": 2.7280542850494385,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08913403749465942,
      "model/modality_embedder.encoders.pose/weight_norm": 30.914859771728516,
      "model/modality_embedder/grad_frac": 0.1063314825296402,
      "model/modality_embedder/grad_norm": 0.055142421275377274,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5438616071428571,
      "model/modality_embedder/update_ratio": 0.0017836865736171603,
      "model/modality_embedder/weight_delta": 2.7280542850494385,
      "model/modality_embedder/weight_delta_rel": 0.08913403749465942,
      "model/modality_embedder/weight_norm": 30.914859771728516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.06660461425781,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.7015712535014,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.290188789367676,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.28794166301229,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08697005361318588,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04510178416967392,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016216059448197484,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.051950454711914,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07477430999279022,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.81303596496582,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 77.63555145263672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.575385883520074,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.835991859436035,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.88843525754258,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08330444246530533,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04320083558559418,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014631507219746709,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.599792242050171,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.090058833360672,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.525896072387695,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.53340148925781,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.21400304913632,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.020548820495605,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.01450831472967,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07723815739154816,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04005492106080055,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001314091496169567,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.7977311611175537,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09394257515668869,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.4810733795166,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.23918151855469,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.157431722689076,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.20567798614502,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.35005069386103,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08003391325473785,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04150477051734924,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013945824466645718,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.3868179321289062,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0815701112151146,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.761432647705078,
      "model/normalizer/grad_frac": 0.3038948178291321,
      "model/normalizer/grad_norm": 0.15759675204753876,
      "model/normalizer/grad_zero_frac": 0.00018907814228441566,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020105906296521425,
      "model/normalizer/weight_delta": 5.064590930938721,
      "model/normalizer/weight_delta_rel": 0.06522899866104126,
      "model/normalizer/weight_norm": 78.38330841064453,
      "pose_mae_dtheta": 0.2615949511528015,
      "pose_mae_dx": 0.07784489542245865,
      "pose_mae_dy": 0.07399000227451324,
      "pose_rmse_dtheta": 0.464368611574173,
      "pose_rmse_dx": 0.16201737523078918,
      "pose_rmse_dy": 0.1873297095298767,
      "pose_rmse_mean": 0.2712385654449463,
      "rmse_dtheta": 0.05133063718676567,
      "rmse_dx": 0.021038003265857697,
      "rmse_dy": 0.010304657742381096,
      "rmse_mean": 0.027557766065001488,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 8715.0,
      "step": 5050,
      "turn_loss": 0.2481285035610199,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.23466827727188255,
      "grad_norm": 0.5032420754432678,
      "learning_rate": 6.319620319235658e-06,
      "loss": 0.1136,
      "mae_dtheta": 0.007044239901006222,
      "mae_dx": 0.0014530281769111753,
      "mae_dy": 0.0011180068831890821,
      "pose_mae_dtheta": 0.05067037045955658,
      "pose_mae_dx": 0.012445044703781605,
      "pose_mae_dy": 0.009994039312005043,
      "pose_rmse_dtheta": 0.18840919435024261,
      "pose_rmse_dx": 0.037973664700984955,
      "pose_rmse_dy": 0.026316920295357704,
      "pose_rmse_mean": 0.08423325419425964,
      "rmse_dtheta": 0.022522559389472008,
      "rmse_dx": 0.004641016945242882,
      "rmse_dy": 0.004288508091121912,
      "rmse_mean": 0.010484028607606888,
      "rotation_flip": 0.005194805096834898,
      "sparse_tokens": 32153.0,
      "step": 5051,
      "turn_loss": 0.05653991922736168,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24910.0,
      "epoch": 0.23471473703772533,
      "grad_norm": 0.47017842531204224,
      "learning_rate": 6.318344935293256e-06,
      "loss": 0.1337,
      "mae_dtheta": 0.034853916615247726,
      "mae_dx": 0.013086913153529167,
      "mae_dy": 0.004602520260959864,
      "pose_mae_dtheta": 0.2917143702507019,
      "pose_mae_dx": 0.11371249705553055,
      "pose_mae_dy": 0.07075893133878708,
      "pose_rmse_dtheta": 0.4793144464492798,
      "pose_rmse_dx": 0.23755456507205963,
      "pose_rmse_dy": 0.16703423857688904,
      "pose_rmse_mean": 0.2946344316005707,
      "rmse_dtheta": 0.051581643521785736,
      "rmse_dx": 0.02541346102952957,
      "rmse_dy": 0.009570782072842121,
      "rmse_mean": 0.028855297714471817,
      "rotation_flip": 0.013215859420597553,
      "sparse_tokens": 18931.0,
      "step": 5052,
      "turn_loss": 0.3097419738769531,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2347611968035681,
      "grad_norm": 0.4253574311733246,
      "learning_rate": 6.317069459158284e-06,
      "loss": 0.1078,
      "mae_dtheta": 0.009641624055802822,
      "mae_dx": 0.001489965128712356,
      "mae_dy": 0.002000617329031229,
      "pose_mae_dtheta": 0.06060895696282387,
      "pose_mae_dx": 0.020850621163845062,
      "pose_mae_dy": 0.02547127939760685,
      "pose_rmse_dtheta": 0.13851319253444672,
      "pose_rmse_dx": 0.052006687968969345,
      "pose_rmse_dy": 0.06207304447889328,
      "pose_rmse_mean": 0.08419764041900635,
      "rmse_dtheta": 0.021048875525593758,
      "rmse_dx": 0.005005788989365101,
      "rmse_dy": 0.004554898012429476,
      "rmse_mean": 0.01020318828523159,
      "rotation_flip": 0.00327198370359838,
      "sparse_tokens": 32105.0,
      "step": 5053,
      "turn_loss": 0.08251304924488068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.23480765656941088,
      "grad_norm": 0.4614100456237793,
      "learning_rate": 6.315793890919938e-06,
      "loss": 0.135,
      "mae_dtheta": 0.03339914232492447,
      "mae_dx": 0.00939597375690937,
      "mae_dy": 0.004056515172123909,
      "pose_mae_dtheta": 0.249540314078331,
      "pose_mae_dx": 0.08174015581607819,
      "pose_mae_dy": 0.03491263836622238,
      "pose_rmse_dtheta": 0.4814801514148712,
      "pose_rmse_dx": 0.19103287160396576,
      "pose_rmse_dy": 0.07900331914424896,
      "pose_rmse_mean": 0.2505054473876953,
      "rmse_dtheta": 0.05450815334916115,
      "rmse_dx": 0.02001599408686161,
      "rmse_dy": 0.010087716393172741,
      "rmse_mean": 0.02820395492017269,
      "rotation_flip": 0.015810277312994003,
      "sparse_tokens": 8254.0,
      "step": 5054,
      "turn_loss": 0.24406348168849945,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.23485411633525366,
      "grad_norm": 0.48783066868782043,
      "learning_rate": 6.314518230667419e-06,
      "loss": 0.0691,
      "mae_dtheta": 0.007102633360773325,
      "mae_dx": 0.0012835231609642506,
      "mae_dy": 0.0013956337934359908,
      "pose_mae_dtheta": 0.046673327684402466,
      "pose_mae_dx": 0.016562024131417274,
      "pose_mae_dy": 0.01836252771317959,
      "pose_rmse_dtheta": 0.0876757800579071,
      "pose_rmse_dx": 0.0375366285443306,
      "pose_rmse_dy": 0.04310963675379753,
      "pose_rmse_mean": 0.05610734969377518,
      "rmse_dtheta": 0.014540381729602814,
      "rmse_dx": 0.003912791609764099,
      "rmse_dy": 0.002859857864677906,
      "rmse_mean": 0.007104343734681606,
      "rotation_flip": 0.0038182511925697327,
      "sparse_tokens": 32137.0,
      "step": 5055,
      "turn_loss": 0.05769363418221474,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.23490057610109644,
      "grad_norm": 0.46684783697128296,
      "learning_rate": 6.313242478489934e-06,
      "loss": 0.094,
      "mae_dtheta": 0.010949690826237202,
      "mae_dx": 0.0031886787619441748,
      "mae_dy": 0.0010538512142375112,
      "pose_mae_dtheta": 0.07766725867986679,
      "pose_mae_dx": 0.029803719371557236,
      "pose_mae_dy": 0.01608685590326786,
      "pose_rmse_dtheta": 0.24067555367946625,
      "pose_rmse_dx": 0.09556885063648224,
      "pose_rmse_dy": 0.045065511018037796,
      "pose_rmse_mean": 0.1271033138036728,
      "rmse_dtheta": 0.031233860179781914,
      "rmse_dx": 0.010005070827901363,
      "rmse_dy": 0.002717245602980256,
      "rmse_mean": 0.014652058482170105,
      "rotation_flip": 0.0019986676052212715,
      "sparse_tokens": 32121.0,
      "step": 5056,
      "turn_loss": 0.11129092425107956,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.23494703586693924,
      "grad_norm": 0.7168886065483093,
      "learning_rate": 6.311966634476698e-06,
      "loss": 0.1689,
      "mae_dtheta": 0.011152527295053005,
      "mae_dx": 0.002261057961732149,
      "mae_dy": 0.0009749135933816433,
      "pose_mae_dtheta": 0.07834288477897644,
      "pose_mae_dx": 0.022115711122751236,
      "pose_mae_dy": 0.013133009895682335,
      "pose_rmse_dtheta": 0.2543494701385498,
      "pose_rmse_dx": 0.05665259435772896,
      "pose_rmse_dy": 0.03598816692829132,
      "pose_rmse_mean": 0.11566340923309326,
      "rmse_dtheta": 0.030545104295015335,
      "rmse_dx": 0.006475946865975857,
      "rmse_dy": 0.0024127366486936808,
      "rmse_mean": 0.013144596479833126,
      "rotation_flip": 0.0019841270986944437,
      "sparse_tokens": 32185.0,
      "step": 5057,
      "turn_loss": 0.08328019082546234,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30400.0,
      "epoch": 0.23499349563278202,
      "grad_norm": 0.5250831842422485,
      "learning_rate": 6.310690698716931e-06,
      "loss": 0.1552,
      "mae_dtheta": 0.033312901854515076,
      "mae_dx": 0.014911706559360027,
      "mae_dy": 0.006678967271000147,
      "pose_mae_dtheta": 0.2471972107887268,
      "pose_mae_dx": 0.11970458179712296,
      "pose_mae_dy": 0.09379696846008301,
      "pose_rmse_dtheta": 0.4095890522003174,
      "pose_rmse_dx": 0.2521347999572754,
      "pose_rmse_dy": 0.20737901329994202,
      "pose_rmse_mean": 0.2897009551525116,
      "rmse_dtheta": 0.0480634942650795,
      "rmse_dx": 0.028056683018803596,
      "rmse_dy": 0.012425369583070278,
      "rmse_mean": 0.029515182599425316,
      "rotation_flip": 0.012269938364624977,
      "sparse_tokens": 24332.0,
      "step": 5058,
      "turn_loss": 0.32246509194374084,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2350399553986248,
      "grad_norm": 0.3850204348564148,
      "learning_rate": 6.3094146712998595e-06,
      "loss": 0.0782,
      "mae_dtheta": 0.006628493778407574,
      "mae_dx": 0.0019759528804570436,
      "mae_dy": 0.0008703252533450723,
      "pose_mae_dtheta": 0.051456984132528305,
      "pose_mae_dx": 0.016974149271845818,
      "pose_mae_dy": 0.013022182509303093,
      "pose_rmse_dtheta": 0.17510157823562622,
      "pose_rmse_dx": 0.060458648949861526,
      "pose_rmse_dy": 0.04025717452168465,
      "pose_rmse_mean": 0.09193913638591766,
      "rmse_dtheta": 0.020156005397439003,
      "rmse_dx": 0.00708313612267375,
      "rmse_dy": 0.004093292634934187,
      "rmse_mean": 0.01044414471834898,
      "rotation_flip": 0.002298850566148758,
      "sparse_tokens": 32073.0,
      "step": 5059,
      "turn_loss": 0.04391143471002579,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23508641516446757,
      "grad_norm": 0.3915604054927826,
      "learning_rate": 6.3081385523147175e-06,
      "loss": 0.0713,
      "mae_dtheta": 0.007093979977071285,
      "mae_dx": 0.0009501517051830888,
      "mae_dy": 0.0012200601631775498,
      "pose_mae_dtheta": 0.0505157932639122,
      "pose_mae_dx": 0.014514426700770855,
      "pose_mae_dy": 0.019085222855210304,
      "pose_rmse_dtheta": 0.16432343423366547,
      "pose_rmse_dx": 0.035346563905477524,
      "pose_rmse_dy": 0.04477139934897423,
      "pose_rmse_mean": 0.081480473279953,
      "rmse_dtheta": 0.018949121236801147,
      "rmse_dx": 0.0029432091396301985,
      "rmse_dy": 0.0025200797244906425,
      "rmse_mean": 0.008137470111250877,
      "rotation_flip": 0.005898366682231426,
      "sparse_tokens": 32089.0,
      "step": 5060,
      "turn_loss": 0.054050907492637634,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.23513287493031035,
      "grad_norm": 0.48780348896980286,
      "learning_rate": 6.306862341850746e-06,
      "loss": 0.1433,
      "mae_dtheta": 0.030345119535923004,
      "mae_dx": 0.016240201890468597,
      "mae_dy": 0.007498050574213266,
      "pose_mae_dtheta": 0.2415533810853958,
      "pose_mae_dx": 0.12564094364643097,
      "pose_mae_dy": 0.08968722820281982,
      "pose_rmse_dtheta": 0.43237781524658203,
      "pose_rmse_dx": 0.2527605891227722,
      "pose_rmse_dy": 0.17951305210590363,
      "pose_rmse_mean": 0.288217157125473,
      "rmse_dtheta": 0.04649794101715088,
      "rmse_dx": 0.0302218459546566,
      "rmse_dy": 0.012428528629243374,
      "rmse_mean": 0.02971610799431801,
      "rotation_flip": 0.0016286644386127591,
      "sparse_tokens": 10074.0,
      "step": 5061,
      "turn_loss": 0.27444562315940857,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23517933469615313,
      "grad_norm": 0.6022853851318359,
      "learning_rate": 6.305586039997188e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.010148183442652225,
      "mae_dx": 0.0018080583540722728,
      "mae_dy": 0.002399059711024165,
      "pose_mae_dtheta": 0.07041698694229126,
      "pose_mae_dx": 0.02376633882522583,
      "pose_mae_dy": 0.02460908330976963,
      "pose_rmse_dtheta": 0.20283453166484833,
      "pose_rmse_dx": 0.06116596609354019,
      "pose_rmse_dy": 0.05460140481591225,
      "pose_rmse_mean": 0.10620063543319702,
      "rmse_dtheta": 0.024238135665655136,
      "rmse_dx": 0.005382456351071596,
      "rmse_dy": 0.005386935546994209,
      "rmse_mean": 0.011669176630675793,
      "rotation_flip": 0.0030131826642900705,
      "sparse_tokens": 32105.0,
      "step": 5062,
      "turn_loss": 0.08271737396717072,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2352257944619959,
      "grad_norm": 0.6190920472145081,
      "learning_rate": 6.304309646843297e-06,
      "loss": 0.1581,
      "mae_dtheta": 0.013031091541051865,
      "mae_dx": 0.0022655141074210405,
      "mae_dy": 0.004201863426715136,
      "pose_mae_dtheta": 0.09578695893287659,
      "pose_mae_dx": 0.033888380974531174,
      "pose_mae_dy": 0.04276727885007858,
      "pose_rmse_dtheta": 0.22278901934623718,
      "pose_rmse_dx": 0.08187007904052734,
      "pose_rmse_dy": 0.10516534745693207,
      "pose_rmse_mean": 0.13660815358161926,
      "rmse_dtheta": 0.026329712942242622,
      "rmse_dx": 0.005958198104053736,
      "rmse_dy": 0.009367934428155422,
      "rmse_mean": 0.01388528198003769,
      "rotation_flip": 0.00346981268376112,
      "sparse_tokens": 32073.0,
      "step": 5063,
      "turn_loss": 0.12409551441669464,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.23527225422783868,
      "grad_norm": 0.36031052470207214,
      "learning_rate": 6.303033162478333e-06,
      "loss": 0.08,
      "mae_dtheta": 0.04134846106171608,
      "mae_dx": 0.016002396121621132,
      "mae_dy": 0.005308179650455713,
      "pose_mae_dtheta": 0.3773002326488495,
      "pose_mae_dx": 0.13749295473098755,
      "pose_mae_dy": 0.05094083398580551,
      "pose_rmse_dtheta": 0.5886450409889221,
      "pose_rmse_dx": 0.25324127078056335,
      "pose_rmse_dy": 0.1041482537984848,
      "pose_rmse_mean": 0.3153448700904846,
      "rmse_dtheta": 0.0573846660554409,
      "rmse_dx": 0.028175465762615204,
      "rmse_dy": 0.009038727730512619,
      "rmse_mean": 0.031532954424619675,
      "rotation_flip": 0.006430868059396744,
      "sparse_tokens": 4611.0,
      "step": 5064,
      "turn_loss": 0.2774325907230377,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.23531871399368148,
      "grad_norm": 0.43859782814979553,
      "learning_rate": 6.301756586991561e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.009657453745603561,
      "mae_dx": 0.0017351247370243073,
      "mae_dy": 0.0022430410608649254,
      "pose_mae_dtheta": 0.06823605298995972,
      "pose_mae_dx": 0.020846283063292503,
      "pose_mae_dy": 0.029493017122149467,
      "pose_rmse_dtheta": 0.14858931303024292,
      "pose_rmse_dx": 0.053094569593667984,
      "pose_rmse_dy": 0.0808485895395279,
      "pose_rmse_mean": 0.0941774845123291,
      "rmse_dtheta": 0.020414825528860092,
      "rmse_dx": 0.0053747426718473434,
      "rmse_dy": 0.005529975518584251,
      "rmse_mean": 0.010439848527312279,
      "rotation_flip": 0.004629629664123058,
      "sparse_tokens": 32121.0,
      "step": 5065,
      "turn_loss": 0.08249463140964508,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.23536517375952426,
      "grad_norm": 0.5039871335029602,
      "learning_rate": 6.300479920472252e-06,
      "loss": 0.1178,
      "mae_dtheta": 0.029327208176255226,
      "mae_dx": 0.011423319578170776,
      "mae_dy": 0.003081665839999914,
      "pose_mae_dtheta": 0.21132898330688477,
      "pose_mae_dx": 0.09350913017988205,
      "pose_mae_dy": 0.034902069717645645,
      "pose_rmse_dtheta": 0.36685314774513245,
      "pose_rmse_dx": 0.2301936149597168,
      "pose_rmse_dy": 0.0847981795668602,
      "pose_rmse_mean": 0.2272816300392151,
      "rmse_dtheta": 0.043855421245098114,
      "rmse_dx": 0.023745868355035782,
      "rmse_dy": 0.006155554670840502,
      "rmse_mean": 0.02458561770617962,
      "rotation_flip": 0.016826923936605453,
      "sparse_tokens": 5793.0,
      "step": 5066,
      "turn_loss": 0.19005374610424042,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.23541163352536704,
      "grad_norm": 0.5844555497169495,
      "learning_rate": 6.299203163009684e-06,
      "loss": 0.1445,
      "mae_dtheta": 0.03415108472108841,
      "mae_dx": 0.005563080310821533,
      "mae_dy": 0.008057063445448875,
      "pose_mae_dtheta": 0.2606702744960785,
      "pose_mae_dx": 0.07992137968540192,
      "pose_mae_dy": 0.10473877936601639,
      "pose_rmse_dtheta": 0.5017814636230469,
      "pose_rmse_dx": 0.17747221887111664,
      "pose_rmse_dy": 0.22988484799861908,
      "pose_rmse_mean": 0.30304619669914246,
      "rmse_dtheta": 0.05268879234790802,
      "rmse_dx": 0.012750577181577682,
      "rmse_dy": 0.014677696861326694,
      "rmse_mean": 0.02670568972826004,
      "rotation_flip": 0.013975155539810658,
      "sparse_tokens": 11586.0,
      "step": 5067,
      "turn_loss": 0.24808864295482635,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2354580932912098,
      "grad_norm": 0.47074249386787415,
      "learning_rate": 6.297926314693141e-06,
      "loss": 0.1334,
      "mae_dtheta": 0.013801880180835724,
      "mae_dx": 0.003179495455697179,
      "mae_dy": 0.005436414387077093,
      "pose_mae_dtheta": 0.09981611371040344,
      "pose_mae_dx": 0.03885573521256447,
      "pose_mae_dy": 0.05005345121026039,
      "pose_rmse_dtheta": 0.22204089164733887,
      "pose_rmse_dx": 0.09472160041332245,
      "pose_rmse_dy": 0.1286168098449707,
      "pose_rmse_mean": 0.1484597772359848,
      "rmse_dtheta": 0.025992710143327713,
      "rmse_dx": 0.009123312309384346,
      "rmse_dy": 0.012356630526483059,
      "rmse_mean": 0.015824219211935997,
      "rotation_flip": 0.013217278756201267,
      "sparse_tokens": 32041.0,
      "step": 5068,
      "turn_loss": 0.12499924004077911,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1980.0,
      "epoch": 0.2355045530570526,
      "grad_norm": 0.6845695972442627,
      "learning_rate": 6.296649375611915e-06,
      "loss": 0.1443,
      "mae_dtheta": 0.04454931244254112,
      "mae_dx": 0.00812896154820919,
      "mae_dy": 0.011601260863244534,
      "pose_mae_dtheta": 0.4446254074573517,
      "pose_mae_dx": 0.06351958960294724,
      "pose_mae_dy": 0.25295984745025635,
      "pose_rmse_dtheta": 0.638813853263855,
      "pose_rmse_dx": 0.11243440955877304,
      "pose_rmse_dy": 0.45895832777023315,
      "pose_rmse_mean": 0.403402179479599,
      "rmse_dtheta": 0.05837671831250191,
      "rmse_dx": 0.01854870654642582,
      "rmse_dy": 0.016452332958579063,
      "rmse_mean": 0.03112592175602913,
      "rotation_flip": 0.0416666679084301,
      "sparse_tokens": 1654.0,
      "step": 5069,
      "turn_loss": 0.28004300594329834,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.23555101282289537,
      "grad_norm": 0.7258982062339783,
      "learning_rate": 6.295372345855301e-06,
      "loss": 0.1624,
      "mae_dtheta": 0.03583100810647011,
      "mae_dx": 0.009903891012072563,
      "mae_dy": 0.005414509680122137,
      "pose_mae_dtheta": 0.2993186116218567,
      "pose_mae_dx": 0.07337604463100433,
      "pose_mae_dy": 0.10880125313997269,
      "pose_rmse_dtheta": 0.5498669743537903,
      "pose_rmse_dx": 0.17022687196731567,
      "pose_rmse_dy": 0.21941201388835907,
      "pose_rmse_mean": 0.31316864490509033,
      "rmse_dtheta": 0.053582776337862015,
      "rmse_dx": 0.02350209839642048,
      "rmse_dy": 0.008957154117524624,
      "rmse_mean": 0.028680678457021713,
      "rotation_flip": 0.004807692486792803,
      "sparse_tokens": 3866.0,
      "step": 5070,
      "turn_loss": 0.264629602432251,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.23559747258873814,
      "grad_norm": 0.7893423438072205,
      "learning_rate": 6.294095225512604e-06,
      "loss": 0.2742,
      "mae_dtheta": 0.038980528712272644,
      "mae_dx": 0.006998454686254263,
      "mae_dy": 0.005050070583820343,
      "pose_mae_dtheta": 0.30703088641166687,
      "pose_mae_dx": 0.058743130415678024,
      "pose_mae_dy": 0.04415315017104149,
      "pose_rmse_dtheta": 0.559415340423584,
      "pose_rmse_dx": 0.1285552978515625,
      "pose_rmse_dy": 0.10916556417942047,
      "pose_rmse_mean": 0.26571208238601685,
      "rmse_dtheta": 0.059405237436294556,
      "rmse_dx": 0.015844637528061867,
      "rmse_dy": 0.011778753250837326,
      "rmse_mean": 0.029009541496634483,
      "rotation_flip": 0.015544041059911251,
      "sparse_tokens": 16294.0,
      "step": 5071,
      "turn_loss": 0.2541743814945221,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.23564393235458092,
      "grad_norm": 0.6234470009803772,
      "learning_rate": 6.292818014673134e-06,
      "loss": 0.1549,
      "mae_dtheta": 0.011419806629419327,
      "mae_dx": 0.002445060992613435,
      "mae_dy": 0.0030260556377470493,
      "pose_mae_dtheta": 0.08015203475952148,
      "pose_mae_dx": 0.02659592404961586,
      "pose_mae_dy": 0.027444561943411827,
      "pose_rmse_dtheta": 0.1928900182247162,
      "pose_rmse_dx": 0.06656262278556824,
      "pose_rmse_dy": 0.06384783238172531,
      "pose_rmse_mean": 0.10776682943105698,
      "rmse_dtheta": 0.024938363581895828,
      "rmse_dx": 0.006782436743378639,
      "rmse_dy": 0.006810307502746582,
      "rmse_mean": 0.012843703851103783,
      "rotation_flip": 0.005018820520490408,
      "sparse_tokens": 32121.0,
      "step": 5072,
      "turn_loss": 0.09128724038600922,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30819.0,
      "epoch": 0.23569039212042373,
      "grad_norm": 0.6132279634475708,
      "learning_rate": 6.291540713426206e-06,
      "loss": 0.15,
      "mae_dtheta": 0.030754538252949715,
      "mae_dx": 0.012321148067712784,
      "mae_dy": 0.005780414212495089,
      "pose_mae_dtheta": 0.2259623408317566,
      "pose_mae_dx": 0.09802465885877609,
      "pose_mae_dy": 0.06168254837393761,
      "pose_rmse_dtheta": 0.39715340733528137,
      "pose_rmse_dx": 0.2432471513748169,
      "pose_rmse_dy": 0.15917211771011353,
      "pose_rmse_mean": 0.26652422547340393,
      "rmse_dtheta": 0.04937170073390007,
      "rmse_dx": 0.026326747611165047,
      "rmse_dy": 0.013643520884215832,
      "rmse_mean": 0.029780656099319458,
      "rotation_flip": 0.013523131608963013,
      "sparse_tokens": 24333.0,
      "step": 5073,
      "turn_loss": 0.23752887547016144,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2357368518862665,
      "grad_norm": 0.45172005891799927,
      "learning_rate": 6.290263321861143e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.0103520592674613,
      "mae_dx": 0.002303533488884568,
      "mae_dy": 0.0029158962424844503,
      "pose_mae_dtheta": 0.07325654476881027,
      "pose_mae_dx": 0.03104519657790661,
      "pose_mae_dy": 0.031295161694288254,
      "pose_rmse_dtheta": 0.19134768843650818,
      "pose_rmse_dx": 0.08574481308460236,
      "pose_rmse_dy": 0.07244110107421875,
      "pose_rmse_mean": 0.11651121079921722,
      "rmse_dtheta": 0.022786052897572517,
      "rmse_dx": 0.007212766911834478,
      "rmse_dy": 0.006259748712182045,
      "rmse_mean": 0.012086190283298492,
      "rotation_flip": 0.0021079257130622864,
      "sparse_tokens": 32089.0,
      "step": 5074,
      "turn_loss": 0.09062747657299042,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.23578331165210928,
      "grad_norm": 0.4372509717941284,
      "learning_rate": 6.288985840067273e-06,
      "loss": 0.129,
      "mae_dtheta": 0.011746419593691826,
      "mae_dx": 0.002332800766453147,
      "mae_dy": 0.0025412235409021378,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4372510612010956,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.63583374023438,
      "model/head/act_norm_mean": 109.08360953282828,
      "model/head/act_norm_min": 53.51604080200195,
      "model/head/act_over_embed": 74.96327772780221,
      "model/head/grad_frac": 0.10985834151506424,
      "model/head/grad_norm": 0.04803567752242088,
      "model/head/grad_zero_frac": 0.00018465216271579266,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6974481139520202,
      "model/head/update_ratio": 0.000822610454633832,
      "model/head/weight_delta": 8.344106674194336,
      "model/head/weight_delta_rel": 0.14638034999370575,
      "model/head/weight_norm": 58.39419937133789,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4199969470500946,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.419914478818402,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.41984856128692627,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2885691611452952,
      "model/modality_embedder.encoders.pose/grad_frac": 0.13303381204605103,
      "model/modality_embedder.encoders.pose/grad_norm": 0.058169178664684296,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5499368859170306,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0018815473886206746,
      "model/modality_embedder.encoders.pose/weight_delta": 2.733898878097534,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08932499587535858,
      "model/modality_embedder.encoders.pose/weight_norm": 30.915605545043945,
      "model/modality_embedder/grad_frac": 0.13303381204605103,
      "model/modality_embedder/grad_norm": 0.058169178664684296,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5499368859170306,
      "model/modality_embedder/update_ratio": 0.0018815473886206746,
      "model/modality_embedder/weight_delta": 2.733898878097534,
      "model/modality_embedder/weight_delta_rel": 0.08932499587535858,
      "model/modality_embedder/weight_norm": 30.915605545043945,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.45680236816406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.509930655763988,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.026302337646484,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.156244450079598,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08302507549524307,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.036302801221609116,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013051790883764625,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.058274507522583,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07500476390123367,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.814422607421875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.07953643798828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.524475909892576,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.359484672546387,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.853449447039083,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08601493388414383,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.037610121071338654,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012737142387777567,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.606996774673462,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09030840545892715,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.527910232543945,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.13621520996094,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.41821238175405,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.096611976623535,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.154842879942468,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08835071325302124,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03863144293427467,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012673004530370235,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.805955410003662,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09421873092651367,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.48325538635254,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.71661376953125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.251851350809684,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.724364280700684,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.414936746275995,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08997839689254761,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03934314846992493,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013218953972682357,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.3937926292419434,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08180847018957138,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.762678146362305,
      "model/normalizer/grad_frac": 0.32418522238731384,
      "model/normalizer/grad_norm": 0.14175033569335938,
      "model/normalizer/grad_zero_frac": 0.0002079859550576657,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018083746545016766,
      "model/normalizer/weight_delta": 5.079428195953369,
      "model/normalizer/weight_delta_rel": 0.06542009115219116,
      "model/normalizer/weight_norm": 78.38549041748047,
      "pose_mae_dtheta": 0.07951436191797256,
      "pose_mae_dx": 0.026572775095701218,
      "pose_mae_dy": 0.029596364125609398,
      "pose_rmse_dtheta": 0.19954697787761688,
      "pose_rmse_dx": 0.05782875418663025,
      "pose_rmse_dy": 0.06641082465648651,
      "pose_rmse_mean": 0.10792885720729828,
      "rmse_dtheta": 0.024437202140688896,
      "rmse_dx": 0.006200768519192934,
      "rmse_dy": 0.004970138426870108,
      "rmse_mean": 0.011869370006024837,
      "rotation_flip": 0.005778382066637278,
      "sparse_tokens": 32153.0,
      "step": 5075,
      "turn_loss": 0.10571695864200592,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.23582977141795206,
      "grad_norm": 0.7335556745529175,
      "learning_rate": 6.287708268133932e-06,
      "loss": 0.1626,
      "mae_dtheta": 0.04019219055771828,
      "mae_dx": 0.007322340272367001,
      "mae_dy": 0.0032382416538894176,
      "pose_mae_dtheta": 0.2828015089035034,
      "pose_mae_dx": 0.05186592414975166,
      "pose_mae_dy": 0.025148076936602592,
      "pose_rmse_dtheta": 0.5030142068862915,
      "pose_rmse_dx": 0.11921089142560959,
      "pose_rmse_dy": 0.05535576865077019,
      "pose_rmse_mean": 0.22586029767990112,
      "rmse_dtheta": 0.05971004441380501,
      "rmse_dx": 0.017206843942403793,
      "rmse_dy": 0.007565265521407127,
      "rmse_mean": 0.028160719200968742,
      "rotation_flip": 0.01965065486729145,
      "sparse_tokens": 7564.0,
      "step": 5076,
      "turn_loss": 0.19595366716384888,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.23587623118379483,
      "grad_norm": 0.5459228754043579,
      "learning_rate": 6.286430606150458e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.01889548823237419,
      "mae_dx": 0.0090378038585186,
      "mae_dy": 0.007763653062283993,
      "pose_mae_dtheta": 0.1533161848783493,
      "pose_mae_dx": 0.07062315195798874,
      "pose_mae_dy": 0.11010165512561798,
      "pose_rmse_dtheta": 0.2588319480419159,
      "pose_rmse_dx": 0.1660570651292801,
      "pose_rmse_dy": 0.2051251232624054,
      "pose_rmse_mean": 0.21000473201274872,
      "rmse_dtheta": 0.03022708371281624,
      "rmse_dx": 0.021291585639119148,
      "rmse_dy": 0.013938653282821178,
      "rmse_mean": 0.021819107234477997,
      "rotation_flip": 0.010695187374949455,
      "sparse_tokens": 4260.0,
      "step": 5077,
      "turn_loss": 0.09711738675832748,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2359226909496376,
      "grad_norm": 0.6705319881439209,
      "learning_rate": 6.285152854206203e-06,
      "loss": 0.1576,
      "mae_dtheta": 0.0144012700766325,
      "mae_dx": 0.0028095536399632692,
      "mae_dy": 0.0036305191460996866,
      "pose_mae_dtheta": 0.10411174595355988,
      "pose_mae_dx": 0.033799249678850174,
      "pose_mae_dy": 0.0418250672519207,
      "pose_rmse_dtheta": 0.2444118857383728,
      "pose_rmse_dx": 0.1158415898680687,
      "pose_rmse_dy": 0.11436320096254349,
      "pose_rmse_mean": 0.1582055687904358,
      "rmse_dtheta": 0.0290943905711174,
      "rmse_dx": 0.00888295192271471,
      "rmse_dy": 0.009690821170806885,
      "rmse_mean": 0.01588938757777214,
      "rotation_flip": 0.004464285913854837,
      "sparse_tokens": 32089.0,
      "step": 5078,
      "turn_loss": 0.11966580152511597,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.23596915071548039,
      "grad_norm": 0.9920206665992737,
      "learning_rate": 6.28387501239052e-06,
      "loss": 0.2935,
      "mae_dtheta": 0.03595767542719841,
      "mae_dx": 0.012109136208891869,
      "mae_dy": 0.008150850422680378,
      "pose_mae_dtheta": 0.29922494292259216,
      "pose_mae_dx": 0.10129716992378235,
      "pose_mae_dy": 0.10253839194774628,
      "pose_rmse_dtheta": 0.4848514497280121,
      "pose_rmse_dx": 0.20581355690956116,
      "pose_rmse_dy": 0.24210579693317413,
      "pose_rmse_mean": 0.31092360615730286,
      "rmse_dtheta": 0.05179379880428314,
      "rmse_dx": 0.024054456502199173,
      "rmse_dy": 0.015728844329714775,
      "rmse_mean": 0.030525699257850647,
      "rotation_flip": 0.011789181269705296,
      "sparse_tokens": 22016.0,
      "step": 5079,
      "turn_loss": 0.2988174259662628,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23601561048132316,
      "grad_norm": 0.37751519680023193,
      "learning_rate": 6.282597080792768e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.010044286027550697,
      "mae_dx": 0.002007991075515747,
      "mae_dy": 0.002786400495097041,
      "pose_mae_dtheta": 0.06576801091432571,
      "pose_mae_dx": 0.02434513531625271,
      "pose_mae_dy": 0.031557463109493256,
      "pose_rmse_dtheta": 0.1262252777814865,
      "pose_rmse_dx": 0.05820634588599205,
      "pose_rmse_dy": 0.06631205230951309,
      "pose_rmse_mean": 0.08358123153448105,
      "rmse_dtheta": 0.02013559266924858,
      "rmse_dx": 0.0054611461237072945,
      "rmse_dy": 0.005280183628201485,
      "rmse_mean": 0.01029230747371912,
      "rotation_flip": 0.003902093041688204,
      "sparse_tokens": 32105.0,
      "step": 5080,
      "turn_loss": 0.08546530455350876,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.23606207024716597,
      "grad_norm": 0.4611109793186188,
      "learning_rate": 6.2813190595023135e-06,
      "loss": 0.1061,
      "mae_dtheta": 0.011675102636218071,
      "mae_dx": 0.003912454936653376,
      "mae_dy": 0.004139026626944542,
      "pose_mae_dtheta": 0.09064837545156479,
      "pose_mae_dx": 0.04494145140051842,
      "pose_mae_dy": 0.04472525045275688,
      "pose_rmse_dtheta": 0.23867033421993256,
      "pose_rmse_dx": 0.11314688622951508,
      "pose_rmse_dy": 0.11959818005561829,
      "pose_rmse_mean": 0.15713846683502197,
      "rmse_dtheta": 0.027494555339217186,
      "rmse_dx": 0.009463891386985779,
      "rmse_dy": 0.010515430010855198,
      "rmse_mean": 0.01582462713122368,
      "rotation_flip": 0.0038643195293843746,
      "sparse_tokens": 32153.0,
      "step": 5081,
      "turn_loss": 0.1343671679496765,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.23610853001300874,
      "grad_norm": 0.5232065320014954,
      "learning_rate": 6.28004094860853e-06,
      "loss": 0.167,
      "mae_dtheta": 0.03336266055703163,
      "mae_dx": 0.008946570567786694,
      "mae_dy": 0.009066134691238403,
      "pose_mae_dtheta": 0.2629229724407196,
      "pose_mae_dx": 0.08097083121538162,
      "pose_mae_dy": 0.16172797977924347,
      "pose_rmse_dtheta": 0.4928281903266907,
      "pose_rmse_dx": 0.18188807368278503,
      "pose_rmse_dy": 0.3740801215171814,
      "pose_rmse_mean": 0.34959882497787476,
      "rmse_dtheta": 0.055235154926776886,
      "rmse_dx": 0.022305894643068314,
      "rmse_dy": 0.01758224330842495,
      "rmse_mean": 0.0317077673971653,
      "rotation_flip": 0.017605634406208992,
      "sparse_tokens": 4866.0,
      "step": 5082,
      "turn_loss": 0.23221442103385925,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.23615498977885152,
      "grad_norm": 0.6600088477134705,
      "learning_rate": 6.278762748200795e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.04247079789638519,
      "mae_dx": 0.025314224883913994,
      "mae_dy": 0.0075275045819580555,
      "pose_mae_dtheta": 0.3294726014137268,
      "pose_mae_dx": 0.21054714918136597,
      "pose_mae_dy": 0.08781982958316803,
      "pose_rmse_dtheta": 0.5327757596969604,
      "pose_rmse_dx": 0.3736802935600281,
      "pose_rmse_dy": 0.1828901767730713,
      "pose_rmse_mean": 0.3631154000759125,
      "rmse_dtheta": 0.05820867046713829,
      "rmse_dx": 0.038533374667167664,
      "rmse_dy": 0.013296816498041153,
      "rmse_mean": 0.036679621785879135,
      "rotation_flip": 0.018832391127943993,
      "sparse_tokens": 9526.0,
      "step": 5083,
      "turn_loss": 0.35947269201278687,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.2362014495446943,
      "grad_norm": 0.9163691997528076,
      "learning_rate": 6.277484458368495e-06,
      "loss": 0.2191,
      "mae_dtheta": 0.03296589106321335,
      "mae_dx": 0.00748961977660656,
      "mae_dy": 0.006910841912031174,
      "pose_mae_dtheta": 0.24601179361343384,
      "pose_mae_dx": 0.06595337390899658,
      "pose_mae_dy": 0.07716892659664154,
      "pose_rmse_dtheta": 0.4490261971950531,
      "pose_rmse_dx": 0.1402757316827774,
      "pose_rmse_dy": 0.1714913547039032,
      "pose_rmse_mean": 0.25359779596328735,
      "rmse_dtheta": 0.05106455460190773,
      "rmse_dx": 0.016560418531298637,
      "rmse_dy": 0.012941294349730015,
      "rmse_mean": 0.02685542218387127,
      "rotation_flip": 0.00913241971284151,
      "sparse_tokens": 14315.0,
      "step": 5084,
      "turn_loss": 0.23622381687164307,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.23624790931053707,
      "grad_norm": 0.4714260399341583,
      "learning_rate": 6.276206079201022e-06,
      "loss": 0.1435,
      "mae_dtheta": 0.010909223929047585,
      "mae_dx": 0.001631107646971941,
      "mae_dy": 0.0021247367840260267,
      "pose_mae_dtheta": 0.07271450757980347,
      "pose_mae_dx": 0.017649628221988678,
      "pose_mae_dy": 0.028718464076519012,
      "pose_rmse_dtheta": 0.1732887625694275,
      "pose_rmse_dx": 0.043966054916381836,
      "pose_rmse_dy": 0.07143016904592514,
      "pose_rmse_mean": 0.09622833132743835,
      "rmse_dtheta": 0.02317650243639946,
      "rmse_dx": 0.005102981347590685,
      "rmse_dy": 0.004173547960817814,
      "rmse_mean": 0.010817676782608032,
      "rotation_flip": 0.007518797181546688,
      "sparse_tokens": 32073.0,
      "step": 5085,
      "turn_loss": 0.07994437217712402,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23629436907637985,
      "grad_norm": 0.45873749256134033,
      "learning_rate": 6.274927610787771e-06,
      "loss": 0.147,
      "mae_dtheta": 0.015398691408336163,
      "mae_dx": 0.002889326075091958,
      "mae_dy": 0.004446295090019703,
      "pose_mae_dtheta": 0.11026933044195175,
      "pose_mae_dx": 0.033592719584703445,
      "pose_mae_dy": 0.04120687395334244,
      "pose_rmse_dtheta": 0.23719370365142822,
      "pose_rmse_dx": 0.08145636320114136,
      "pose_rmse_dy": 0.0829256922006607,
      "pose_rmse_mean": 0.1338585913181305,
      "rmse_dtheta": 0.02876879647374153,
      "rmse_dx": 0.008763978257775307,
      "rmse_dy": 0.010411021299660206,
      "rmse_mean": 0.015981266275048256,
      "rotation_flip": 0.0054054055362939835,
      "sparse_tokens": 32105.0,
      "step": 5086,
      "turn_loss": 0.14069212973117828,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.23634082884222263,
      "grad_norm": 0.5218106508255005,
      "learning_rate": 6.2736490532181494e-06,
      "loss": 0.084,
      "mae_dtheta": 0.008015037514269352,
      "mae_dx": 0.00165027123875916,
      "mae_dy": 0.0011680939933285117,
      "pose_mae_dtheta": 0.055786505341529846,
      "pose_mae_dx": 0.01690792664885521,
      "pose_mae_dy": 0.01926269568502903,
      "pose_rmse_dtheta": 0.15702824294567108,
      "pose_rmse_dx": 0.04594310000538826,
      "pose_rmse_dy": 0.047009292989969254,
      "pose_rmse_mean": 0.08332687616348267,
      "rmse_dtheta": 0.02072019875049591,
      "rmse_dx": 0.005541705526411533,
      "rmse_dy": 0.0025269403122365475,
      "rmse_mean": 0.009596281684935093,
      "rotation_flip": 0.003618817776441574,
      "sparse_tokens": 32073.0,
      "step": 5087,
      "turn_loss": 0.0630355253815651,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2363872886080654,
      "grad_norm": 0.48452797532081604,
      "learning_rate": 6.272370406581565e-06,
      "loss": 0.1324,
      "mae_dtheta": 0.01063754316419363,
      "mae_dx": 0.002279880689457059,
      "mae_dy": 0.0030026761814951897,
      "pose_mae_dtheta": 0.07031940668821335,
      "pose_mae_dx": 0.023906029760837555,
      "pose_mae_dy": 0.032238323241472244,
      "pose_rmse_dtheta": 0.1473102569580078,
      "pose_rmse_dx": 0.06510570645332336,
      "pose_rmse_dy": 0.08380978554487228,
      "pose_rmse_mean": 0.09874191880226135,
      "rmse_dtheta": 0.021160926669836044,
      "rmse_dx": 0.0074575371108949184,
      "rmse_dy": 0.008003294467926025,
      "rmse_mean": 0.012207252904772758,
      "rotation_flip": 0.010390689596533775,
      "sparse_tokens": 32073.0,
      "step": 5088,
      "turn_loss": 0.10490559786558151,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2364337483739082,
      "grad_norm": 0.43382546305656433,
      "learning_rate": 6.271091670967437e-06,
      "loss": 0.1102,
      "mae_dtheta": 0.010408940725028515,
      "mae_dx": 0.0015003075823187828,
      "mae_dy": 0.0023017115890979767,
      "pose_mae_dtheta": 0.06766311824321747,
      "pose_mae_dx": 0.020549314096570015,
      "pose_mae_dy": 0.02931751124560833,
      "pose_rmse_dtheta": 0.13681364059448242,
      "pose_rmse_dx": 0.05367410555481911,
      "pose_rmse_dy": 0.06869017332792282,
      "pose_rmse_mean": 0.08639264106750488,
      "rmse_dtheta": 0.020324762910604477,
      "rmse_dx": 0.0044814590364694595,
      "rmse_dy": 0.005204403772950172,
      "rmse_mean": 0.01000354252755642,
      "rotation_flip": 0.009185303933918476,
      "sparse_tokens": 32073.0,
      "step": 5089,
      "turn_loss": 0.0864705964922905,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.23648020813975099,
      "grad_norm": 0.7798978686332703,
      "learning_rate": 6.269812846465183e-06,
      "loss": 0.1532,
      "mae_dtheta": 0.03727919980883598,
      "mae_dx": 0.015401122160255909,
      "mae_dy": 0.003401231486350298,
      "pose_mae_dtheta": 0.31626415252685547,
      "pose_mae_dx": 0.12263514846563339,
      "pose_mae_dy": 0.05030043050646782,
      "pose_rmse_dtheta": 0.5716021060943604,
      "pose_rmse_dx": 0.25697842240333557,
      "pose_rmse_dy": 0.12211735546588898,
      "pose_rmse_mean": 0.31689929962158203,
      "rmse_dtheta": 0.057864926755428314,
      "rmse_dx": 0.02833874709904194,
      "rmse_dy": 0.006297314073890448,
      "rmse_mean": 0.030833661556243896,
      "rotation_flip": 0.007462686393409967,
      "sparse_tokens": 17918.0,
      "step": 5090,
      "turn_loss": 0.28721097111701965,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.23652666790559376,
      "grad_norm": 0.3964201509952545,
      "learning_rate": 6.268533933164237e-06,
      "loss": 0.0722,
      "mae_dtheta": 0.03279859572649002,
      "mae_dx": 0.00756075931712985,
      "mae_dy": 0.007393610663712025,
      "pose_mae_dtheta": 0.2227075695991516,
      "pose_mae_dx": 0.07174525409936905,
      "pose_mae_dy": 0.1020110473036766,
      "pose_rmse_dtheta": 0.4811749756336212,
      "pose_rmse_dx": 0.1428203582763672,
      "pose_rmse_dy": 0.1791975498199463,
      "pose_rmse_mean": 0.2677309513092041,
      "rmse_dtheta": 0.05261934548616409,
      "rmse_dx": 0.017744744196534157,
      "rmse_dy": 0.012398879043757915,
      "rmse_mean": 0.027587655931711197,
      "rotation_flip": 0.013483146205544472,
      "sparse_tokens": 7603.0,
      "step": 5091,
      "turn_loss": 0.2924031615257263,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.23657312767143654,
      "grad_norm": 0.4192284941673279,
      "learning_rate": 6.267254931154032e-06,
      "loss": 0.059,
      "mae_dtheta": 0.0061159683391451836,
      "mae_dx": 0.0011687491787597537,
      "mae_dy": 0.0007346850470639765,
      "pose_mae_dtheta": 0.045265790075063705,
      "pose_mae_dx": 0.011263705790042877,
      "pose_mae_dy": 0.010887817479670048,
      "pose_rmse_dtheta": 0.17781193554401398,
      "pose_rmse_dx": 0.024403361603617668,
      "pose_rmse_dy": 0.024581527337431908,
      "pose_rmse_mean": 0.07559894025325775,
      "rmse_dtheta": 0.020213162526488304,
      "rmse_dx": 0.0032321319449692965,
      "rmse_dy": 0.0017548069590702653,
      "rmse_mean": 0.00840003415942192,
      "rotation_flip": 0.0022967385593801737,
      "sparse_tokens": 32185.0,
      "step": 5092,
      "turn_loss": 0.03921743109822273,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.23661958743727932,
      "grad_norm": 0.4360103905200958,
      "learning_rate": 6.26597584052401e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.007869631983339787,
      "mae_dx": 0.0013623995473608375,
      "mae_dy": 0.00022035242000129074,
      "pose_mae_dtheta": 0.054871462285518646,
      "pose_mae_dx": 0.011219545267522335,
      "pose_mae_dy": 0.0031358920969069004,
      "pose_rmse_dtheta": 0.23577722907066345,
      "pose_rmse_dx": 0.026999419555068016,
      "pose_rmse_dy": 0.006260601803660393,
      "pose_rmse_mean": 0.08967908471822739,
      "rmse_dtheta": 0.02919924072921276,
      "rmse_dx": 0.0037905301433056593,
      "rmse_dy": 0.0003847237676382065,
      "rmse_mean": 0.011124832555651665,
      "rotation_flip": 0.0025380710139870644,
      "sparse_tokens": 32201.0,
      "step": 5093,
      "turn_loss": 0.04052739590406418,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2366660472031221,
      "grad_norm": 0.43402719497680664,
      "learning_rate": 6.264696661363618e-06,
      "loss": 0.1066,
      "mae_dtheta": 0.010219222865998745,
      "mae_dx": 0.0020735913421958685,
      "mae_dy": 0.0023331083357334137,
      "pose_mae_dtheta": 0.07635744661092758,
      "pose_mae_dx": 0.02439250983297825,
      "pose_mae_dy": 0.029177235439419746,
      "pose_rmse_dtheta": 0.19659501314163208,
      "pose_rmse_dx": 0.06523381173610687,
      "pose_rmse_dy": 0.0730036273598671,
      "pose_rmse_mean": 0.11161082237958908,
      "rmse_dtheta": 0.022573409602046013,
      "rmse_dx": 0.005968330428004265,
      "rmse_dy": 0.005495769437402487,
      "rmse_mean": 0.011345836333930492,
      "rotation_flip": 0.0027384755667299032,
      "sparse_tokens": 32073.0,
      "step": 5094,
      "turn_loss": 0.08453188091516495,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.23671250696896487,
      "grad_norm": 0.45496588945388794,
      "learning_rate": 6.2634173937623075e-06,
      "loss": 0.0936,
      "mae_dtheta": 0.007475612219423056,
      "mae_dx": 0.0012320809764787555,
      "mae_dy": 0.0007348246872425079,
      "pose_mae_dtheta": 0.0541444793343544,
      "pose_mae_dx": 0.01127530075609684,
      "pose_mae_dy": 0.012587054632604122,
      "pose_rmse_dtheta": 0.2010987251996994,
      "pose_rmse_dx": 0.026874978095293045,
      "pose_rmse_dy": 0.0346965566277504,
      "pose_rmse_mean": 0.08755674958229065,
      "rmse_dtheta": 0.02463342994451523,
      "rmse_dx": 0.003505517728626728,
      "rmse_dy": 0.0018213692819699645,
      "rmse_mean": 0.009986772201955318,
      "rotation_flip": 0.0027998134028166533,
      "sparse_tokens": 32185.0,
      "step": 5095,
      "turn_loss": 0.04136326164007187,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23675896673480765,
      "grad_norm": 0.5368570685386658,
      "learning_rate": 6.262138037809542e-06,
      "loss": 0.0901,
      "mae_dtheta": 0.008110349997878075,
      "mae_dx": 0.002324997214600444,
      "mae_dy": 0.002737123053520918,
      "pose_mae_dtheta": 0.0531502403318882,
      "pose_mae_dx": 0.025546779856085777,
      "pose_mae_dy": 0.02340329810976982,
      "pose_rmse_dtheta": 0.12167669087648392,
      "pose_rmse_dx": 0.07991030812263489,
      "pose_rmse_dy": 0.04708871617913246,
      "pose_rmse_mean": 0.08289190381765366,
      "rmse_dtheta": 0.0186522975564003,
      "rmse_dx": 0.007034786511212587,
      "rmse_dy": 0.007004276383668184,
      "rmse_mean": 0.010897120460867882,
      "rotation_flip": 0.004417670890688896,
      "sparse_tokens": 32105.0,
      "step": 5096,
      "turn_loss": 0.07749615609645844,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.23680542650065042,
      "grad_norm": 0.3165205419063568,
      "learning_rate": 6.260858593594786e-06,
      "loss": 0.0734,
      "mae_dtheta": 0.050949037075042725,
      "mae_dx": 0.009198199026286602,
      "mae_dy": 0.010457392781972885,
      "pose_mae_dtheta": 0.3941155970096588,
      "pose_mae_dx": 0.05232582613825798,
      "pose_mae_dy": 0.11246228963136673,
      "pose_rmse_dtheta": 0.7378777265548706,
      "pose_rmse_dx": 0.1614329069852829,
      "pose_rmse_dy": 0.3206618130207062,
      "pose_rmse_mean": 0.40665751695632935,
      "rmse_dtheta": 0.07804571837186813,
      "rmse_dx": 0.02157404273748398,
      "rmse_dy": 0.022369029000401497,
      "rmse_mean": 0.04066292941570282,
      "rotation_flip": 0.007246376946568489,
      "sparse_tokens": 2427.0,
      "step": 5097,
      "turn_loss": 0.3490775227546692,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 31466.0,
      "epoch": 0.23685188626649323,
      "grad_norm": 0.5110476016998291,
      "learning_rate": 6.259579061207512e-06,
      "loss": 0.1373,
      "mae_dtheta": 0.028323832899332047,
      "mae_dx": 0.011905533261597157,
      "mae_dy": 0.003789036301895976,
      "pose_mae_dtheta": 0.19922876358032227,
      "pose_mae_dx": 0.08573780208826065,
      "pose_mae_dy": 0.04477468505501747,
      "pose_rmse_dtheta": 0.3850075900554657,
      "pose_rmse_dx": 0.18467532098293304,
      "pose_rmse_dy": 0.10753944516181946,
      "pose_rmse_mean": 0.22574079036712646,
      "rmse_dtheta": 0.04640613868832588,
      "rmse_dx": 0.023322485387325287,
      "rmse_dy": 0.007771560922265053,
      "rmse_mean": 0.02583339624106884,
      "rotation_flip": 0.014361300505697727,
      "sparse_tokens": 25108.0,
      "step": 5098,
      "turn_loss": 0.26912614703178406,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.236898346032336,
      "grad_norm": 0.6167773604393005,
      "learning_rate": 6.2582994407371986e-06,
      "loss": 0.2086,
      "mae_dtheta": 0.031759005039930344,
      "mae_dx": 0.0134046021848917,
      "mae_dy": 0.0023514926433563232,
      "pose_mae_dtheta": 0.2724660038948059,
      "pose_mae_dx": 0.10434383153915405,
      "pose_mae_dy": 0.0246464591473341,
      "pose_rmse_dtheta": 0.5016148090362549,
      "pose_rmse_dx": 0.2351738065481186,
      "pose_rmse_dy": 0.06698043644428253,
      "pose_rmse_mean": 0.2679230272769928,
      "rmse_dtheta": 0.05139913037419319,
      "rmse_dx": 0.026346150785684586,
      "rmse_dy": 0.005122782662510872,
      "rmse_mean": 0.027622688561677933,
      "rotation_flip": 0.012096773833036423,
      "sparse_tokens": 8429.0,
      "step": 5099,
      "turn_loss": 0.24202711880207062,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.23694480579817878,
      "grad_norm": 0.39633122086524963,
      "learning_rate": 6.25701973227333e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.02487194910645485,
      "mae_dx": 0.013806168921291828,
      "mae_dy": 0.004081860650330782,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.39633113145828247,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.0631561279297,
      "model/head/act_norm_mean": 114.8267897002551,
      "model/head/act_norm_min": 65.0243911743164,
      "model/head/act_over_embed": 78.91004490735779,
      "model/head/grad_frac": 0.10687193274497986,
      "model/head/grad_norm": 0.04235667362809181,
      "model/head/grad_zero_frac": 0.00020241938182152808,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6968670280612245,
      "model/head/update_ratio": 0.0007253019139170647,
      "model/head/weight_delta": 8.364100456237793,
      "model/head/weight_delta_rel": 0.14673109352588654,
      "model/head/weight_norm": 58.398677825927734,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42013630270957947,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.420076904296875,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4200221300125122,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2886807814547531,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09266431629657745,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03672575205564499,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5280078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011879181256517768,
      "model/modality_embedder.encoders.pose/weight_delta": 2.743837356567383,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08964972198009491,
      "model/modality_embedder.encoders.pose/weight_norm": 30.91606330871582,
      "model/modality_embedder/grad_frac": 0.09266431629657745,
      "model/modality_embedder/grad_norm": 0.03672575205564499,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5280078125,
      "model/modality_embedder/update_ratio": 0.0011879181256517768,
      "model/modality_embedder/weight_delta": 2.743837356567383,
      "model/modality_embedder/weight_delta_rel": 0.08964972198009491,
      "model/modality_embedder/weight_norm": 30.91606330871582,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.44141387939453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.94693472627146,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.136886596679688,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.456557738628902,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07237289100885391,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.028683628886938095,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003026145859621465,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001031232182867825,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.064495801925659,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07523147016763687,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.814908981323242,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.88874816894531,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.75362913022352,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.156908988952637,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.010925685416755,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07038445770740509,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.027895551174879074,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009446573676541448,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.615135431289673,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09059033542871475,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.529808044433594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.62583923339844,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.349618865403304,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.194121360778809,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.10770477332362,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06828111410140991,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.027061931788921356,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008877033251337707,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.814854621887207,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0945175513625145,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.485332489013672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.50350189208984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.230976170229997,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.033329010009766,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.400591126745116,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0636139065027237,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02521217241883278,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008470580214634538,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.402771472930908,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08211532980203629,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.7643985748291,
      "model/normalizer/grad_frac": 0.23299142718315125,
      "model/normalizer/grad_norm": 0.09234175831079483,
      "model/normalizer/grad_zero_frac": 0.00025998245109803975,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0011780165368691087,
      "model/normalizer/weight_delta": 5.095938682556152,
      "model/normalizer/weight_delta_rel": 0.06563273817300797,
      "model/normalizer/weight_norm": 78.38748931884766,
      "pose_mae_dtheta": 0.19688363373279572,
      "pose_mae_dx": 0.11828026920557022,
      "pose_mae_dy": 0.07687712460756302,
      "pose_rmse_dtheta": 0.36562660336494446,
      "pose_rmse_dx": 0.2617172300815582,
      "pose_rmse_dy": 0.16296905279159546,
      "pose_rmse_mean": 0.2634376287460327,
      "rmse_dtheta": 0.04369727149605751,
      "rmse_dx": 0.02814132161438465,
      "rmse_dy": 0.008110950700938702,
      "rmse_mean": 0.026649847626686096,
      "rotation_flip": 0.011070110835134983,
      "sparse_tokens": 12516.0,
      "step": 5100,
      "turn_loss": 0.24982251226902008,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23699126556402156,
      "grad_norm": 0.6309193968772888,
      "learning_rate": 6.255739935905396e-06,
      "loss": 0.0898,
      "mae_dtheta": 0.01355729065835476,
      "mae_dx": 0.0027504509780555964,
      "mae_dy": 0.0032449038699269295,
      "pose_mae_dtheta": 0.10167568176984787,
      "pose_mae_dx": 0.033917032182216644,
      "pose_mae_dy": 0.03569880500435829,
      "pose_rmse_dtheta": 0.23965226113796234,
      "pose_rmse_dx": 0.09320446848869324,
      "pose_rmse_dy": 0.08517906069755554,
      "pose_rmse_mean": 0.13934525847434998,
      "rmse_dtheta": 0.02700849249958992,
      "rmse_dx": 0.008935489691793919,
      "rmse_dy": 0.008055020123720169,
      "rmse_mean": 0.014666333794593811,
      "rotation_flip": 0.004179331474006176,
      "sparse_tokens": 32105.0,
      "step": 5101,
      "turn_loss": 0.11515897512435913,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23703772532986433,
      "grad_norm": 0.4142908453941345,
      "learning_rate": 6.254460051722895e-06,
      "loss": 0.114,
      "mae_dtheta": 0.006721364799886942,
      "mae_dx": 0.0013427664525806904,
      "mae_dy": 0.0015739949885755777,
      "pose_mae_dtheta": 0.043307237327098846,
      "pose_mae_dx": 0.01563042216002941,
      "pose_mae_dy": 0.019469616934657097,
      "pose_rmse_dtheta": 0.09439895302057266,
      "pose_rmse_dx": 0.04267202690243721,
      "pose_rmse_dy": 0.044070832431316376,
      "pose_rmse_mean": 0.06038060784339905,
      "rmse_dtheta": 0.015462935902178288,
      "rmse_dx": 0.0042442986741662025,
      "rmse_dy": 0.003566767554730177,
      "rmse_mean": 0.007758000865578651,
      "rotation_flip": 0.003242241684347391,
      "sparse_tokens": 32089.0,
      "step": 5102,
      "turn_loss": 0.058249395340681076,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2370841850957071,
      "grad_norm": 0.4724363088607788,
      "learning_rate": 6.253180079815329e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.011317025870084763,
      "mae_dx": 0.002159289550036192,
      "mae_dy": 0.0019057778408750892,
      "pose_mae_dtheta": 0.08292141556739807,
      "pose_mae_dx": 0.022437453269958496,
      "pose_mae_dy": 0.02156458981335163,
      "pose_rmse_dtheta": 0.23178912699222565,
      "pose_rmse_dx": 0.058380335569381714,
      "pose_rmse_dy": 0.06041617691516876,
      "pose_rmse_mean": 0.11686187982559204,
      "rmse_dtheta": 0.027786366641521454,
      "rmse_dx": 0.006316577084362507,
      "rmse_dy": 0.004988986533135176,
      "rmse_mean": 0.013030643574893475,
      "rotation_flip": 0.003568596439436078,
      "sparse_tokens": 32185.0,
      "step": 5103,
      "turn_loss": 0.0930364653468132,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.2371306448615499,
      "grad_norm": 0.6990867853164673,
      "learning_rate": 6.251900020272208e-06,
      "loss": 0.189,
      "mae_dtheta": 0.04069405794143677,
      "mae_dx": 0.014535932801663876,
      "mae_dy": 0.005233332514762878,
      "pose_mae_dtheta": 0.3178892731666565,
      "pose_mae_dx": 0.11255659908056259,
      "pose_mae_dy": 0.058264534920454025,
      "pose_rmse_dtheta": 0.5135427713394165,
      "pose_rmse_dx": 0.22684870660305023,
      "pose_rmse_dy": 0.12030229717493057,
      "pose_rmse_mean": 0.2868979573249817,
      "rmse_dtheta": 0.06061231344938278,
      "rmse_dx": 0.026017354801297188,
      "rmse_dy": 0.011161942034959793,
      "rmse_mean": 0.03259720653295517,
      "rotation_flip": 0.006666666828095913,
      "sparse_tokens": 7825.0,
      "step": 5104,
      "turn_loss": 0.24846519529819489,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.23717710462739267,
      "grad_norm": 0.5740079283714294,
      "learning_rate": 6.250619873183046e-06,
      "loss": 0.0673,
      "mae_dtheta": 0.006880844011902809,
      "mae_dx": 0.0011685127392411232,
      "mae_dy": 0.0010769234504550695,
      "pose_mae_dtheta": 0.04415306821465492,
      "pose_mae_dx": 0.01309455931186676,
      "pose_mae_dy": 0.015395238064229488,
      "pose_rmse_dtheta": 0.1159566342830658,
      "pose_rmse_dx": 0.02838979847729206,
      "pose_rmse_dy": 0.03640633076429367,
      "pose_rmse_mean": 0.06025091931223869,
      "rmse_dtheta": 0.017241662368178368,
      "rmse_dx": 0.003272835398092866,
      "rmse_dy": 0.0023955805227160454,
      "rmse_mean": 0.007636692374944687,
      "rotation_flip": 0.002958579920232296,
      "sparse_tokens": 32137.0,
      "step": 5105,
      "turn_loss": 0.05774455517530441,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64681.0,
      "epoch": 0.23722356439323547,
      "grad_norm": 0.33442896604537964,
      "learning_rate": 6.249339638637365e-06,
      "loss": 0.0801,
      "mae_dtheta": 0.009682262316346169,
      "mae_dx": 0.00254859053529799,
      "mae_dy": 0.0019647658336907625,
      "pose_mae_dtheta": 0.07133536785840988,
      "pose_mae_dx": 0.021048447117209435,
      "pose_mae_dy": 0.01995369791984558,
      "pose_rmse_dtheta": 0.16986697912216187,
      "pose_rmse_dx": 0.05350199714303017,
      "pose_rmse_dy": 0.0533125177025795,
      "pose_rmse_mean": 0.09222716093063354,
      "rmse_dtheta": 0.023065883666276932,
      "rmse_dx": 0.006947497371584177,
      "rmse_dy": 0.004871922079473734,
      "rmse_mean": 0.01162843406200409,
      "rotation_flip": 0.005821917671710253,
      "sparse_tokens": 32281.0,
      "step": 5106,
      "turn_loss": 0.08737639337778091,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.23727002415907825,
      "grad_norm": 0.5395124554634094,
      "learning_rate": 6.248059316724693e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.03616006672382355,
      "mae_dx": 0.01561227347701788,
      "mae_dy": 0.004322536755353212,
      "pose_mae_dtheta": 0.29564857482910156,
      "pose_mae_dx": 0.13648006319999695,
      "pose_mae_dy": 0.0626959502696991,
      "pose_rmse_dtheta": 0.46906912326812744,
      "pose_rmse_dx": 0.28184860944747925,
      "pose_rmse_dy": 0.15279732644557953,
      "pose_rmse_mean": 0.30123835802078247,
      "rmse_dtheta": 0.05109759420156479,
      "rmse_dx": 0.0283378753811121,
      "rmse_dy": 0.009488608688116074,
      "rmse_mean": 0.02964136004447937,
      "rotation_flip": 0.011644832789897919,
      "sparse_tokens": 12256.0,
      "step": 5107,
      "turn_loss": 0.267700731754303,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.23731648392492102,
      "grad_norm": 0.47413966059684753,
      "learning_rate": 6.246778907534563e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.02570178546011448,
      "mae_dx": 0.005257084965705872,
      "mae_dy": 0.004670578055083752,
      "pose_mae_dtheta": 0.17275768518447876,
      "pose_mae_dx": 0.049410734325647354,
      "pose_mae_dy": 0.05066118389368057,
      "pose_rmse_dtheta": 0.2602681517601013,
      "pose_rmse_dx": 0.1015017181634903,
      "pose_rmse_dy": 0.11678306758403778,
      "pose_rmse_mean": 0.15951764583587646,
      "rmse_dtheta": 0.039103735238313675,
      "rmse_dx": 0.012903734110295773,
      "rmse_dy": 0.00893566757440567,
      "rmse_mean": 0.020314380526542664,
      "rotation_flip": 0.008547008968889713,
      "sparse_tokens": 4467.0,
      "step": 5108,
      "turn_loss": 0.275170236825943,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.2373629436907638,
      "grad_norm": 0.696739912033081,
      "learning_rate": 6.245498411156513e-06,
      "loss": 0.1469,
      "mae_dtheta": 0.027669595554471016,
      "mae_dx": 0.012840967625379562,
      "mae_dy": 0.0032042446546256542,
      "pose_mae_dtheta": 0.21311882138252258,
      "pose_mae_dx": 0.09413639456033707,
      "pose_mae_dy": 0.03395644575357437,
      "pose_rmse_dtheta": 0.3801835775375366,
      "pose_rmse_dx": 0.250099241733551,
      "pose_rmse_dy": 0.07648125290870667,
      "pose_rmse_mean": 0.23558804392814636,
      "rmse_dtheta": 0.04509933665394783,
      "rmse_dx": 0.027550959959626198,
      "rmse_dy": 0.00679863290861249,
      "rmse_mean": 0.026482976973056793,
      "rotation_flip": 0.01244813296943903,
      "sparse_tokens": 4268.0,
      "step": 5109,
      "turn_loss": 0.2483571618795395,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.23740940345660658,
      "grad_norm": 0.5129941701889038,
      "learning_rate": 6.244217827680093e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.013571190647780895,
      "mae_dx": 0.0029373138677328825,
      "mae_dy": 0.003360138274729252,
      "pose_mae_dtheta": 0.09188182651996613,
      "pose_mae_dx": 0.030710486695170403,
      "pose_mae_dy": 0.03503222391009331,
      "pose_rmse_dtheta": 0.22918760776519775,
      "pose_rmse_dx": 0.07286694645881653,
      "pose_rmse_dy": 0.07219650596380234,
      "pose_rmse_mean": 0.12475036084651947,
      "rmse_dtheta": 0.027353106066584587,
      "rmse_dx": 0.009597676806151867,
      "rmse_dy": 0.00754611985757947,
      "rmse_mean": 0.014832301065325737,
      "rotation_flip": 0.0026569245383143425,
      "sparse_tokens": 32121.0,
      "step": 5110,
      "turn_loss": 0.12950566411018372,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.23745586322244935,
      "grad_norm": 0.5427946448326111,
      "learning_rate": 6.242937157194851e-06,
      "loss": 0.1651,
      "mae_dtheta": 0.04454604908823967,
      "mae_dx": 0.014635101892054081,
      "mae_dy": 0.0054483297280967236,
      "pose_mae_dtheta": 0.37922507524490356,
      "pose_mae_dx": 0.1060340628027916,
      "pose_mae_dy": 0.061958760023117065,
      "pose_rmse_dtheta": 0.5915220975875854,
      "pose_rmse_dx": 0.1996515691280365,
      "pose_rmse_dy": 0.15492554008960724,
      "pose_rmse_mean": 0.3153664171695709,
      "rmse_dtheta": 0.061524856835603714,
      "rmse_dx": 0.025817489251494408,
      "rmse_dy": 0.01410779356956482,
      "rmse_mean": 0.03381671383976936,
      "rotation_flip": 0.01588628813624382,
      "sparse_tokens": 18893.0,
      "step": 5111,
      "turn_loss": 0.38020819425582886,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.23750232298829213,
      "grad_norm": 0.5907474160194397,
      "learning_rate": 6.241656399790347e-06,
      "loss": 0.1271,
      "mae_dtheta": 0.03980768471956253,
      "mae_dx": 0.012706277891993523,
      "mae_dy": 0.005774314049631357,
      "pose_mae_dtheta": 0.3370809555053711,
      "pose_mae_dx": 0.1029505729675293,
      "pose_mae_dy": 0.06789818406105042,
      "pose_rmse_dtheta": 0.5824882984161377,
      "pose_rmse_dx": 0.2343374341726303,
      "pose_rmse_dy": 0.14422747492790222,
      "pose_rmse_mean": 0.32035109400749207,
      "rmse_dtheta": 0.05931246653199196,
      "rmse_dx": 0.025745276361703873,
      "rmse_dy": 0.01038325671106577,
      "rmse_mean": 0.031813666224479675,
      "rotation_flip": 0.017500000074505806,
      "sparse_tokens": 14671.0,
      "step": 5112,
      "turn_loss": 0.23578020930290222,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2375487827541349,
      "grad_norm": 0.548324704170227,
      "learning_rate": 6.240375555556145e-06,
      "loss": 0.094,
      "mae_dtheta": 0.008279552683234215,
      "mae_dx": 0.0014555470552295446,
      "mae_dy": 0.0008446839055977762,
      "pose_mae_dtheta": 0.058566853404045105,
      "pose_mae_dx": 0.01313776709139347,
      "pose_mae_dy": 0.012903653085231781,
      "pose_rmse_dtheta": 0.2019532173871994,
      "pose_rmse_dx": 0.03125733137130737,
      "pose_rmse_dy": 0.03366263583302498,
      "pose_rmse_mean": 0.08895772695541382,
      "rmse_dtheta": 0.024818912148475647,
      "rmse_dx": 0.0043670558370649815,
      "rmse_dy": 0.002018562750890851,
      "rmse_mean": 0.010401510633528233,
      "rotation_flip": 0.00401606410741806,
      "sparse_tokens": 32153.0,
      "step": 5113,
      "turn_loss": 0.05304722860455513,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2375952425199777,
      "grad_norm": 0.7627678513526917,
      "learning_rate": 6.239094624581814e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.006302724592387676,
      "mae_dx": 0.0021180876065045595,
      "mae_dy": 0.0016636691289022565,
      "pose_mae_dtheta": 0.0488453209400177,
      "pose_mae_dx": 0.023402707651257515,
      "pose_mae_dy": 0.022823264822363853,
      "pose_rmse_dtheta": 0.12964530289173126,
      "pose_rmse_dx": 0.08703786134719849,
      "pose_rmse_dy": 0.06673827767372131,
      "pose_rmse_mean": 0.09447382390499115,
      "rmse_dtheta": 0.01720098778605461,
      "rmse_dx": 0.008194481953978539,
      "rmse_dy": 0.004905892536044121,
      "rmse_mean": 0.010100454092025757,
      "rotation_flip": 0.0013360053999349475,
      "sparse_tokens": 32057.0,
      "step": 5114,
      "turn_loss": 0.057428937405347824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2309.0,
      "epoch": 0.2376417022858205,
      "grad_norm": 0.5971315503120422,
      "learning_rate": 6.237813606956931e-06,
      "loss": 0.0913,
      "mae_dtheta": 0.03582901507616043,
      "mae_dx": 0.01802588440477848,
      "mae_dy": 0.004159487318247557,
      "pose_mae_dtheta": 0.1934758722782135,
      "pose_mae_dx": 0.15123076736927032,
      "pose_mae_dy": 0.06271668523550034,
      "pose_rmse_dtheta": 0.33117249608039856,
      "pose_rmse_dx": 0.32369571924209595,
      "pose_rmse_dy": 0.10489659756422043,
      "pose_rmse_mean": 0.2532549500465393,
      "rmse_dtheta": 0.05334262177348137,
      "rmse_dx": 0.03170977905392647,
      "rmse_dy": 0.007473568897694349,
      "rmse_mean": 0.030841989442706108,
      "rotation_flip": 0.016806723549962044,
      "sparse_tokens": 2029.0,
      "step": 5115,
      "turn_loss": 0.23421825468540192,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.23768816205166327,
      "grad_norm": 1.0416176319122314,
      "learning_rate": 6.236532502771078e-06,
      "loss": 0.3071,
      "mae_dtheta": 0.02058151550590992,
      "mae_dx": 0.009710482321679592,
      "mae_dy": 0.003576101502403617,
      "pose_mae_dtheta": 0.15297621488571167,
      "pose_mae_dx": 0.08957992494106293,
      "pose_mae_dy": 0.048672620207071304,
      "pose_rmse_dtheta": 0.2958665192127228,
      "pose_rmse_dx": 0.2098492681980133,
      "pose_rmse_dy": 0.14307238161563873,
      "pose_rmse_mean": 0.21626272797584534,
      "rmse_dtheta": 0.034151047468185425,
      "rmse_dx": 0.020834218710660934,
      "rmse_dy": 0.007146535441279411,
      "rmse_mean": 0.020710600540041924,
      "rotation_flip": 0.014367816038429737,
      "sparse_tokens": 6936.0,
      "step": 5116,
      "turn_loss": 0.20642703771591187,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.23773462181750604,
      "grad_norm": 0.5945408940315247,
      "learning_rate": 6.235251312113844e-06,
      "loss": 0.13,
      "mae_dtheta": 0.038132444024086,
      "mae_dx": 0.008976653218269348,
      "mae_dy": 0.004430792760103941,
      "pose_mae_dtheta": 0.28379008173942566,
      "pose_mae_dx": 0.07262879610061646,
      "pose_mae_dy": 0.04360857978463173,
      "pose_rmse_dtheta": 0.5090299248695374,
      "pose_rmse_dx": 0.1798134297132492,
      "pose_rmse_dy": 0.11547736078500748,
      "pose_rmse_mean": 0.26810693740844727,
      "rmse_dtheta": 0.05792932212352753,
      "rmse_dx": 0.019888469949364662,
      "rmse_dy": 0.010055317543447018,
      "rmse_mean": 0.02929103747010231,
      "rotation_flip": 0.02168021723628044,
      "sparse_tokens": 11930.0,
      "step": 5117,
      "turn_loss": 0.29692521691322327,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23778108158334882,
      "grad_norm": 0.5157957077026367,
      "learning_rate": 6.233970035074821e-06,
      "loss": 0.1148,
      "mae_dtheta": 0.011571400798857212,
      "mae_dx": 0.002354290336370468,
      "mae_dy": 0.0026038410142064095,
      "pose_mae_dtheta": 0.08342603594064713,
      "pose_mae_dx": 0.025065835565328598,
      "pose_mae_dy": 0.02961833029985428,
      "pose_rmse_dtheta": 0.24443982541561127,
      "pose_rmse_dx": 0.0696173682808876,
      "pose_rmse_dy": 0.07913816720247269,
      "pose_rmse_mean": 0.13106513023376465,
      "rmse_dtheta": 0.027957763522863388,
      "rmse_dx": 0.0071396855637431145,
      "rmse_dy": 0.007451314479112625,
      "rmse_mean": 0.0141829214990139,
      "rotation_flip": 0.0033065658062696457,
      "sparse_tokens": 32089.0,
      "step": 5118,
      "turn_loss": 0.10171911120414734,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.2378275413491916,
      "grad_norm": 0.360930472612381,
      "learning_rate": 6.232688671743613e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.0394366979598999,
      "mae_dx": 0.009767536073923111,
      "mae_dy": 0.0043639689683914185,
      "pose_mae_dtheta": 0.272271066904068,
      "pose_mae_dx": 0.05834909901022911,
      "pose_mae_dy": 0.05188438668847084,
      "pose_rmse_dtheta": 0.5137034058570862,
      "pose_rmse_dx": 0.14078311622142792,
      "pose_rmse_dy": 0.11472099274396896,
      "pose_rmse_mean": 0.25640252232551575,
      "rmse_dtheta": 0.06006268039345741,
      "rmse_dx": 0.02148107998073101,
      "rmse_dy": 0.008629480376839638,
      "rmse_mean": 0.030057746917009354,
      "rotation_flip": 0.013297872617840767,
      "sparse_tokens": 6971.0,
      "step": 5119,
      "turn_loss": 0.24075797200202942,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 10408.0,
      "epoch": 0.23787400111503437,
      "grad_norm": 0.5864146947860718,
      "learning_rate": 6.231407222209824e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.024003582075238228,
      "mae_dx": 0.012914779596030712,
      "mae_dy": 0.003886726452037692,
      "pose_mae_dtheta": 0.18437747657299042,
      "pose_mae_dx": 0.09008079022169113,
      "pose_mae_dy": 0.05983734130859375,
      "pose_rmse_dtheta": 0.3100418746471405,
      "pose_rmse_dx": 0.22235631942749023,
      "pose_rmse_dy": 0.1353386789560318,
      "pose_rmse_mean": 0.2225789725780487,
      "rmse_dtheta": 0.03916254639625549,
      "rmse_dx": 0.026906367391347885,
      "rmse_dy": 0.007778444327414036,
      "rmse_mean": 0.024615786969661713,
      "rotation_flip": 0.013100436888635159,
      "sparse_tokens": 8177.0,
      "step": 5120,
      "turn_loss": 0.1960218995809555,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.23792046088087715,
      "grad_norm": 0.39341986179351807,
      "learning_rate": 6.230125686563068e-06,
      "loss": 0.1426,
      "mae_dtheta": 0.009703412652015686,
      "mae_dx": 0.0017722976626828313,
      "mae_dy": 0.0017596358666196465,
      "pose_mae_dtheta": 0.06805574893951416,
      "pose_mae_dx": 0.01659347116947174,
      "pose_mae_dy": 0.021381782367825508,
      "pose_rmse_dtheta": 0.1967547982931137,
      "pose_rmse_dx": 0.04009192809462547,
      "pose_rmse_dy": 0.052595872431993484,
      "pose_rmse_mean": 0.09648086875677109,
      "rmse_dtheta": 0.024876147508621216,
      "rmse_dx": 0.007361541036516428,
      "rmse_dy": 0.004961072932928801,
      "rmse_mean": 0.012399587780237198,
      "rotation_flip": 0.004216174595057964,
      "sparse_tokens": 32137.0,
      "step": 5121,
      "turn_loss": 0.08385095000267029,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.23796692064671995,
      "grad_norm": 0.5391642451286316,
      "learning_rate": 6.22884406489296e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.03094683587551117,
      "mae_dx": 0.006911403499543667,
      "mae_dy": 0.005911584477871656,
      "pose_mae_dtheta": 0.24389205873012543,
      "pose_mae_dx": 0.06761246919631958,
      "pose_mae_dy": 0.07088116556406021,
      "pose_rmse_dtheta": 0.46901440620422363,
      "pose_rmse_dx": 0.16673974692821503,
      "pose_rmse_dy": 0.18170905113220215,
      "pose_rmse_mean": 0.2724877595901489,
      "rmse_dtheta": 0.05247252807021141,
      "rmse_dx": 0.01564985327422619,
      "rmse_dy": 0.015038147568702698,
      "rmse_mean": 0.027720175683498383,
      "rotation_flip": 0.017910446971654892,
      "sparse_tokens": 14575.0,
      "step": 5122,
      "turn_loss": 0.271867960691452,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 30173.0,
      "epoch": 0.23801338041256273,
      "grad_norm": 0.5488632321357727,
      "learning_rate": 6.22756235728913e-06,
      "loss": 0.2068,
      "mae_dtheta": 0.035669147968292236,
      "mae_dx": 0.010907221585512161,
      "mae_dy": 0.005320635624229908,
      "pose_mae_dtheta": 0.2554035186767578,
      "pose_mae_dx": 0.07874245196580887,
      "pose_mae_dy": 0.061365190893411636,
      "pose_rmse_dtheta": 0.4807262122631073,
      "pose_rmse_dx": 0.176035538315773,
      "pose_rmse_dy": 0.1337655633687973,
      "pose_rmse_mean": 0.2635091245174408,
      "rmse_dtheta": 0.05399180203676224,
      "rmse_dx": 0.022540824487805367,
      "rmse_dy": 0.010318128392100334,
      "rmse_mean": 0.028950251638889313,
      "rotation_flip": 0.01713859848678112,
      "sparse_tokens": 21105.0,
      "step": 5123,
      "turn_loss": 0.2716207206249237,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 32986.0,
      "epoch": 0.2380598401784055,
      "grad_norm": 0.4267306923866272,
      "learning_rate": 6.2262805638412036e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.03891866281628609,
      "mae_dx": 0.013168666511774063,
      "mae_dy": 0.004537955857813358,
      "pose_mae_dtheta": 0.3100564479827881,
      "pose_mae_dx": 0.09480781853199005,
      "pose_mae_dy": 0.05080600082874298,
      "pose_rmse_dtheta": 0.5352272391319275,
      "pose_rmse_dx": 0.20212915539741516,
      "pose_rmse_dy": 0.12074939161539078,
      "pose_rmse_mean": 0.28603529930114746,
      "rmse_dtheta": 0.05763961374759674,
      "rmse_dx": 0.02522099018096924,
      "rmse_dy": 0.008610769174993038,
      "rmse_mean": 0.030490458011627197,
      "rotation_flip": 0.015883101150393486,
      "sparse_tokens": 26625.0,
      "step": 5124,
      "turn_loss": 0.28690120577812195,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.23810629994424828,
      "grad_norm": 0.3240501582622528,
      "learning_rate": 6.22499868463882e-06,
      "loss": 0.076,
      "mae_dtheta": 0.008122614584863186,
      "mae_dx": 0.0014513812493532896,
      "mae_dy": 0.0012215033639222383,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.32405009865760803,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 166.35008239746094,
      "model/head/act_norm_mean": 125.34201388888889,
      "model/head/act_norm_min": 63.43461227416992,
      "model/head/act_over_embed": 86.1362054148668,
      "model/head/grad_frac": 0.12385518848896027,
      "model/head/grad_norm": 0.04013528674840927,
      "model/head/grad_zero_frac": 0.00018719033687375486,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6903359769570707,
      "model/head/update_ratio": 0.0006872138474136591,
      "model/head/weight_delta": 8.38123607635498,
      "model/head/weight_delta_rel": 0.14703170955181122,
      "model/head/weight_norm": 58.40290832519531,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4200652539730072,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42001067722304186,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4199299216270447,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2886352695895874,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08453885465860367,
      "model/modality_embedder.encoders.pose/grad_norm": 0.027394823729991913,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5358771459227468,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0008860580273903906,
      "model/modality_embedder.encoders.pose/weight_delta": 2.748447895050049,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08980035781860352,
      "model/modality_embedder.encoders.pose/weight_norm": 30.917640686035156,
      "model/modality_embedder/grad_frac": 0.08453885465860367,
      "model/modality_embedder/grad_norm": 0.027394823729991913,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5358771459227468,
      "model/modality_embedder/update_ratio": 0.0008860580273903906,
      "model/modality_embedder/weight_delta": 2.748447895050049,
      "model/modality_embedder/weight_delta_rel": 0.08980035781860352,
      "model/modality_embedder/weight_norm": 30.917640686035156,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.38048553466797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.123624639249638,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.982080459594727,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.265190063172035,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10218457132577896,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03311292082071304,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011903964914381504,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.070549249649048,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07545206695795059,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.816715240478516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.87926483154297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.184173080006413,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.467958450317383,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.99400888067103,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10707862675189972,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.034698840230703354,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011749686673283577,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.6228389739990234,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09085719287395477,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.531715393066406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.62886810302734,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.052772266313934,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.48193073272705,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.278127735602762,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11754968762397766,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0380919873714447,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012494528200477362,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.8229026794433594,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09478778392076492,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.486934661865234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.18256378173828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.792989417989418,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.012444496154785,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.474021254403816,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.14466655254364014,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04687920957803726,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015749268932268023,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.410067081451416,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08236465603113174,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.765958786010742,
      "model/normalizer/grad_frac": 0.5519205331802368,
      "model/normalizer/grad_norm": 0.17884990572929382,
      "model/normalizer/grad_zero_frac": 0.0001607164304004982,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0022815456613898277,
      "model/normalizer/weight_delta": 5.111006736755371,
      "model/normalizer/weight_delta_rel": 0.06582681089639664,
      "model/normalizer/weight_norm": 78.38980102539062,
      "pose_mae_dtheta": 0.051395151764154434,
      "pose_mae_dx": 0.013593154959380627,
      "pose_mae_dy": 0.013934741728007793,
      "pose_rmse_dtheta": 0.16597525775432587,
      "pose_rmse_dx": 0.030386243015527725,
      "pose_rmse_dy": 0.04313329979777336,
      "pose_rmse_mean": 0.07983160018920898,
      "rmse_dtheta": 0.023751232773065567,
      "rmse_dx": 0.0038567446172237396,
      "rmse_dy": 0.0035268596839159727,
      "rmse_mean": 0.01037827879190445,
      "rotation_flip": 0.005062126088887453,
      "sparse_tokens": 32185.0,
      "step": 5125,
      "turn_loss": 0.06166951358318329,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.23815275971009106,
      "grad_norm": 0.4930296838283539,
      "learning_rate": 6.2237167197716195e-06,
      "loss": 0.1451,
      "mae_dtheta": 0.04528717324137688,
      "mae_dx": 0.004644353874027729,
      "mae_dy": 0.0029695224948227406,
      "pose_mae_dtheta": 0.36714833974838257,
      "pose_mae_dx": 0.03609030321240425,
      "pose_mae_dy": 0.02272460050880909,
      "pose_rmse_dtheta": 0.6312975883483887,
      "pose_rmse_dx": 0.07861076295375824,
      "pose_rmse_dy": 0.05578817427158356,
      "pose_rmse_mean": 0.25523218512535095,
      "rmse_dtheta": 0.06817714869976044,
      "rmse_dx": 0.011551638133823872,
      "rmse_dy": 0.007401160895824432,
      "rmse_mean": 0.02904331684112549,
      "rotation_flip": 0.014778325334191322,
      "sparse_tokens": 6458.0,
      "step": 5126,
      "turn_loss": 0.1982068121433258,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.23819921947593384,
      "grad_norm": 0.4910210371017456,
      "learning_rate": 6.222434669329254e-06,
      "loss": 0.0853,
      "mae_dtheta": 0.010106408037245274,
      "mae_dx": 0.0012742036487907171,
      "mae_dy": 0.0024471080396324396,
      "pose_mae_dtheta": 0.0676582008600235,
      "pose_mae_dx": 0.01886942610144615,
      "pose_mae_dy": 0.030598774552345276,
      "pose_rmse_dtheta": 0.14663130044937134,
      "pose_rmse_dx": 0.04874324053525925,
      "pose_rmse_dy": 0.07322360575199127,
      "pose_rmse_mean": 0.08953271806240082,
      "rmse_dtheta": 0.020737487822771072,
      "rmse_dx": 0.003321311669424176,
      "rmse_dy": 0.005160185974091291,
      "rmse_mean": 0.009739662520587444,
      "rotation_flip": 0.009527933783829212,
      "sparse_tokens": 32073.0,
      "step": 5127,
      "turn_loss": 0.08130738139152527,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.23824567924177661,
      "grad_norm": 0.4888819754123688,
      "learning_rate": 6.221152533401374e-06,
      "loss": 0.1731,
      "mae_dtheta": 0.011008893139660358,
      "mae_dx": 0.0027521695010364056,
      "mae_dy": 0.0030389681924134493,
      "pose_mae_dtheta": 0.0762208104133606,
      "pose_mae_dx": 0.028278248384594917,
      "pose_mae_dy": 0.029818283393979073,
      "pose_rmse_dtheta": 0.20106081664562225,
      "pose_rmse_dx": 0.07592326402664185,
      "pose_rmse_dy": 0.06788623332977295,
      "pose_rmse_mean": 0.11495678126811981,
      "rmse_dtheta": 0.025414517149329185,
      "rmse_dx": 0.009737344458699226,
      "rmse_dy": 0.007305673789232969,
      "rmse_mean": 0.014152511954307556,
      "rotation_flip": 0.004598662257194519,
      "sparse_tokens": 32073.0,
      "step": 5128,
      "turn_loss": 0.09938941150903702,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2382921390076194,
      "grad_norm": 0.6721147894859314,
      "learning_rate": 6.219870312077643e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.010740667581558228,
      "mae_dx": 0.0026911969762295485,
      "mae_dy": 0.0035239376593381166,
      "pose_mae_dtheta": 0.0745663046836853,
      "pose_mae_dx": 0.03521374240517616,
      "pose_mae_dy": 0.027464967221021652,
      "pose_rmse_dtheta": 0.17565946280956268,
      "pose_rmse_dx": 0.10659001767635345,
      "pose_rmse_dy": 0.06029631569981575,
      "pose_rmse_mean": 0.11418193578720093,
      "rmse_dtheta": 0.022361839190125465,
      "rmse_dx": 0.008242265321314335,
      "rmse_dy": 0.009099176153540611,
      "rmse_mean": 0.013234427198767662,
      "rotation_flip": 0.0036088055931031704,
      "sparse_tokens": 32137.0,
      "step": 5129,
      "turn_loss": 0.0975509062409401,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23833859877346217,
      "grad_norm": 0.5033296942710876,
      "learning_rate": 6.218588005447725e-06,
      "loss": 0.1134,
      "mae_dtheta": 0.009905082173645496,
      "mae_dx": 0.0020356751047074795,
      "mae_dy": 0.0021513663232326508,
      "pose_mae_dtheta": 0.06707939505577087,
      "pose_mae_dx": 0.024095579981803894,
      "pose_mae_dy": 0.025544704869389534,
      "pose_rmse_dtheta": 0.13337011635303497,
      "pose_rmse_dx": 0.05822554975748062,
      "pose_rmse_dy": 0.053225547075271606,
      "pose_rmse_mean": 0.08160707354545593,
      "rmse_dtheta": 0.020374717190861702,
      "rmse_dx": 0.006255906540900469,
      "rmse_dy": 0.00414254330098629,
      "rmse_mean": 0.010257722809910774,
      "rotation_flip": 0.004615384619683027,
      "sparse_tokens": 32105.0,
      "step": 5130,
      "turn_loss": 0.08240985125303268,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23838505853930497,
      "grad_norm": 0.3144857585430145,
      "learning_rate": 6.217305613601296e-06,
      "loss": 0.0897,
      "mae_dtheta": 0.008908233605325222,
      "mae_dx": 0.001251637819223106,
      "mae_dy": 0.0022892006672918797,
      "pose_mae_dtheta": 0.059610359370708466,
      "pose_mae_dx": 0.020311908796429634,
      "pose_mae_dy": 0.02516994997859001,
      "pose_rmse_dtheta": 0.14411742985248566,
      "pose_rmse_dx": 0.054788991808891296,
      "pose_rmse_dy": 0.05840224772691727,
      "pose_rmse_mean": 0.08576955646276474,
      "rmse_dtheta": 0.019648971036076546,
      "rmse_dx": 0.003650244325399399,
      "rmse_dy": 0.004939461126923561,
      "rmse_mean": 0.009412892162799835,
      "rotation_flip": 0.005319148767739534,
      "sparse_tokens": 32089.0,
      "step": 5131,
      "turn_loss": 0.06926782429218292,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.23843151830514775,
      "grad_norm": 0.49904364347457886,
      "learning_rate": 6.2160231366280295e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.012235958129167557,
      "mae_dx": 0.0022135265171527863,
      "mae_dy": 0.002838458865880966,
      "pose_mae_dtheta": 0.08223468065261841,
      "pose_mae_dx": 0.024311721324920654,
      "pose_mae_dy": 0.0267009437084198,
      "pose_rmse_dtheta": 0.20272637903690338,
      "pose_rmse_dx": 0.06863828748464584,
      "pose_rmse_dy": 0.06049838289618492,
      "pose_rmse_mean": 0.11062102019786835,
      "rmse_dtheta": 0.025757862254977226,
      "rmse_dx": 0.006350486073642969,
      "rmse_dy": 0.007055827882140875,
      "rmse_mean": 0.013054724782705307,
      "rotation_flip": 0.005925409495830536,
      "sparse_tokens": 32153.0,
      "step": 5132,
      "turn_loss": 0.11186809837818146,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.23847797807099053,
      "grad_norm": 0.4796055853366852,
      "learning_rate": 6.214740574617615e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.01060743723064661,
      "mae_dx": 0.002296187449246645,
      "mae_dy": 0.002480528550222516,
      "pose_mae_dtheta": 0.06929678469896317,
      "pose_mae_dx": 0.02646833099424839,
      "pose_mae_dy": 0.029004476964473724,
      "pose_rmse_dtheta": 0.13315574824810028,
      "pose_rmse_dx": 0.07260753214359283,
      "pose_rmse_dy": 0.0631789043545723,
      "pose_rmse_mean": 0.08964739739894867,
      "rmse_dtheta": 0.02032449096441269,
      "rmse_dx": 0.0072971670888364315,
      "rmse_dy": 0.005047102924436331,
      "rmse_mean": 0.010889587923884392,
      "rotation_flip": 0.00602611294016242,
      "sparse_tokens": 32169.0,
      "step": 5133,
      "turn_loss": 0.09080225974321365,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.2385244378368333,
      "grad_norm": 0.4341972768306732,
      "learning_rate": 6.213457927659737e-06,
      "loss": 0.1271,
      "mae_dtheta": 0.029692932963371277,
      "mae_dx": 0.013420091941952705,
      "mae_dy": 0.004651631694287062,
      "pose_mae_dtheta": 0.2441074699163437,
      "pose_mae_dx": 0.11168510466814041,
      "pose_mae_dy": 0.07288362085819244,
      "pose_rmse_dtheta": 0.45648181438446045,
      "pose_rmse_dx": 0.2606288194656372,
      "pose_rmse_dy": 0.15867359936237335,
      "pose_rmse_mean": 0.29192808270454407,
      "rmse_dtheta": 0.04808121919631958,
      "rmse_dx": 0.027309000492095947,
      "rmse_dy": 0.008911174722015858,
      "rmse_mean": 0.02810046635568142,
      "rotation_flip": 0.007712082471698523,
      "sparse_tokens": 14461.0,
      "step": 5134,
      "turn_loss": 0.2445431500673294,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23857089760267608,
      "grad_norm": 0.401960164308548,
      "learning_rate": 6.212175195844098e-06,
      "loss": 0.0832,
      "mae_dtheta": 0.008606412447988987,
      "mae_dx": 0.0009971304098144174,
      "mae_dy": 0.001152088399976492,
      "pose_mae_dtheta": 0.05748733878135681,
      "pose_mae_dx": 0.01109266933053732,
      "pose_mae_dy": 0.014105765148997307,
      "pose_rmse_dtheta": 0.2185470461845398,
      "pose_rmse_dx": 0.02374676801264286,
      "pose_rmse_dy": 0.032201796770095825,
      "pose_rmse_mean": 0.09149853885173798,
      "rmse_dtheta": 0.024987686425447464,
      "rmse_dx": 0.002787776291370392,
      "rmse_dy": 0.0025363473687320948,
      "rmse_mean": 0.010103937238454819,
      "rotation_flip": 0.006730769295245409,
      "sparse_tokens": 32105.0,
      "step": 5135,
      "turn_loss": 0.0592864453792572,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.23861735736851886,
      "grad_norm": 0.7581077218055725,
      "learning_rate": 6.2108923792603945e-06,
      "loss": 0.1541,
      "mae_dtheta": 0.03512704372406006,
      "mae_dx": 0.009869811125099659,
      "mae_dy": 0.004020547494292259,
      "pose_mae_dtheta": 0.28647381067276,
      "pose_mae_dx": 0.0788767859339714,
      "pose_mae_dy": 0.057764824479818344,
      "pose_rmse_dtheta": 0.480282187461853,
      "pose_rmse_dx": 0.17241932451725006,
      "pose_rmse_dy": 0.13585832715034485,
      "pose_rmse_mean": 0.2628532648086548,
      "rmse_dtheta": 0.052854400128126144,
      "rmse_dx": 0.02141140215098858,
      "rmse_dy": 0.008755236864089966,
      "rmse_mean": 0.02767368033528328,
      "rotation_flip": 0.017924528568983078,
      "sparse_tokens": 17845.0,
      "step": 5136,
      "turn_loss": 0.25514036417007446,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.23866381713436163,
      "grad_norm": 0.5024488568305969,
      "learning_rate": 6.209609477998339e-06,
      "loss": 0.1808,
      "mae_dtheta": 0.03752953186631203,
      "mae_dx": 0.014221278950572014,
      "mae_dy": 0.0070246984250843525,
      "pose_mae_dtheta": 0.318134069442749,
      "pose_mae_dx": 0.08981555700302124,
      "pose_mae_dy": 0.10416282713413239,
      "pose_rmse_dtheta": 0.5696051716804504,
      "pose_rmse_dx": 0.20951040089130402,
      "pose_rmse_dy": 0.20823334157466888,
      "pose_rmse_mean": 0.3291163146495819,
      "rmse_dtheta": 0.05442884936928749,
      "rmse_dx": 0.028006892651319504,
      "rmse_dy": 0.010972341522574425,
      "rmse_mean": 0.031136028468608856,
      "rotation_flip": 0.018912529572844505,
      "sparse_tokens": 7081.0,
      "step": 5137,
      "turn_loss": 0.2694709897041321,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2387102769002044,
      "grad_norm": 0.34685567021369934,
      "learning_rate": 6.208326492147642e-06,
      "loss": 0.0947,
      "mae_dtheta": 0.010010342113673687,
      "mae_dx": 0.0017906668363139033,
      "mae_dy": 0.0020408639684319496,
      "pose_mae_dtheta": 0.06569776684045792,
      "pose_mae_dx": 0.019152892753481865,
      "pose_mae_dy": 0.022401226684451103,
      "pose_rmse_dtheta": 0.1551610678434372,
      "pose_rmse_dx": 0.05735594406723976,
      "pose_rmse_dy": 0.05888717994093895,
      "pose_rmse_mean": 0.09046806395053864,
      "rmse_dtheta": 0.022174309939146042,
      "rmse_dx": 0.005712519865483046,
      "rmse_dy": 0.006036018952727318,
      "rmse_mean": 0.011307617649435997,
      "rotation_flip": 0.0014652014942839742,
      "sparse_tokens": 32169.0,
      "step": 5138,
      "turn_loss": 0.07953553646802902,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13647.0,
      "epoch": 0.23875673666604721,
      "grad_norm": 0.35496312379837036,
      "learning_rate": 6.207043421798026e-06,
      "loss": 0.1054,
      "mae_dtheta": 0.03590456023812294,
      "mae_dx": 0.015345115214586258,
      "mae_dy": 0.006275947671383619,
      "pose_mae_dtheta": 0.28061771392822266,
      "pose_mae_dx": 0.1191006600856781,
      "pose_mae_dy": 0.0554342195391655,
      "pose_rmse_dtheta": 0.4930865466594696,
      "pose_rmse_dx": 0.2371055632829666,
      "pose_rmse_dy": 0.15203256905078888,
      "pose_rmse_mean": 0.2940748929977417,
      "rmse_dtheta": 0.054590966552495956,
      "rmse_dx": 0.027687130495905876,
      "rmse_dy": 0.014524312689900398,
      "rmse_mean": 0.03226746991276741,
      "rotation_flip": 0.019801979884505272,
      "sparse_tokens": 11416.0,
      "step": 5139,
      "turn_loss": 0.2946074903011322,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.23880319643189,
      "grad_norm": 0.38300424814224243,
      "learning_rate": 6.205760267039216e-06,
      "loss": 0.0666,
      "mae_dtheta": 0.007242713123559952,
      "mae_dx": 0.0016761744627729058,
      "mae_dy": 0.0012171861017122865,
      "pose_mae_dtheta": 0.046632494777441025,
      "pose_mae_dx": 0.014872326515614986,
      "pose_mae_dy": 0.011377421207726002,
      "pose_rmse_dtheta": 0.17034192383289337,
      "pose_rmse_dx": 0.042025815695524216,
      "pose_rmse_dy": 0.03252967447042465,
      "pose_rmse_mean": 0.08163248002529144,
      "rmse_dtheta": 0.022571783512830734,
      "rmse_dx": 0.004552081692963839,
      "rmse_dy": 0.003610099432989955,
      "rmse_mean": 0.01024465449154377,
      "rotation_flip": 0.005198487546294928,
      "sparse_tokens": 32185.0,
      "step": 5140,
      "turn_loss": 0.053644414991140366,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.23884965619773277,
      "grad_norm": 0.46879032254219055,
      "learning_rate": 6.204477027960942e-06,
      "loss": 0.1281,
      "mae_dtheta": 0.01012078020721674,
      "mae_dx": 0.0014383827801793814,
      "mae_dy": 0.002098687458783388,
      "pose_mae_dtheta": 0.07257508486509323,
      "pose_mae_dx": 0.022170085459947586,
      "pose_mae_dy": 0.02941492386162281,
      "pose_rmse_dtheta": 0.17169995605945587,
      "pose_rmse_dx": 0.061572376638650894,
      "pose_rmse_dy": 0.06918623298406601,
      "pose_rmse_mean": 0.10081952065229416,
      "rmse_dtheta": 0.02171638049185276,
      "rmse_dx": 0.0048265522345900536,
      "rmse_dy": 0.004408102482557297,
      "rmse_mean": 0.01031701173633337,
      "rotation_flip": 0.0021969974040985107,
      "sparse_tokens": 32105.0,
      "step": 5141,
      "turn_loss": 0.07533049583435059,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.23889611596357554,
      "grad_norm": 0.3841439485549927,
      "learning_rate": 6.203193704652943e-06,
      "loss": 0.0685,
      "mae_dtheta": 0.00849167164415121,
      "mae_dx": 0.0025943415239453316,
      "mae_dy": 0.0016042758943513036,
      "pose_mae_dtheta": 0.05510294437408447,
      "pose_mae_dx": 0.028397133573889732,
      "pose_mae_dy": 0.023687392473220825,
      "pose_rmse_dtheta": 0.15014903247356415,
      "pose_rmse_dx": 0.09085588902235031,
      "pose_rmse_dy": 0.06460855156183243,
      "pose_rmse_mean": 0.10187115520238876,
      "rmse_dtheta": 0.02201060578227043,
      "rmse_dx": 0.009690329432487488,
      "rmse_dy": 0.003841979429125786,
      "rmse_mean": 0.011847637593746185,
      "rotation_flip": 0.0018066847696900368,
      "sparse_tokens": 32073.0,
      "step": 5142,
      "turn_loss": 0.09222999960184097,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.23894257572941832,
      "grad_norm": 0.807115912437439,
      "learning_rate": 6.201910297204963e-06,
      "loss": 0.116,
      "mae_dtheta": 0.02118072099983692,
      "mae_dx": 0.007458135019987822,
      "mae_dy": 0.003103541675955057,
      "pose_mae_dtheta": 0.1829874962568283,
      "pose_mae_dx": 0.052462030202150345,
      "pose_mae_dy": 0.04105560854077339,
      "pose_rmse_dtheta": 0.41213399171829224,
      "pose_rmse_dx": 0.14505931735038757,
      "pose_rmse_dy": 0.12394489347934723,
      "pose_rmse_mean": 0.22704605758190155,
      "rmse_dtheta": 0.040773969143629074,
      "rmse_dx": 0.020117003470659256,
      "rmse_dy": 0.0068376087583601475,
      "rmse_mean": 0.022576194256544113,
      "rotation_flip": 0.006493506487458944,
      "sparse_tokens": 5815.0,
      "step": 5143,
      "turn_loss": 0.11582333594560623,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.2389890354952611,
      "grad_norm": 0.8621371984481812,
      "learning_rate": 6.200626805706751e-06,
      "loss": 0.1094,
      "mae_dtheta": 0.028532234951853752,
      "mae_dx": 0.012695696204900742,
      "mae_dy": 0.007955624721944332,
      "pose_mae_dtheta": 0.23015815019607544,
      "pose_mae_dx": 0.09159398823976517,
      "pose_mae_dy": 0.06891678273677826,
      "pose_rmse_dtheta": 0.4283443093299866,
      "pose_rmse_dx": 0.1993650645017624,
      "pose_rmse_dy": 0.14459674060344696,
      "pose_rmse_mean": 0.2574353814125061,
      "rmse_dtheta": 0.043250877410173416,
      "rmse_dx": 0.024597525596618652,
      "rmse_dy": 0.015370587818324566,
      "rmse_mean": 0.027739662677049637,
      "rotation_flip": 0.019607843831181526,
      "sparse_tokens": 2613.0,
      "step": 5144,
      "turn_loss": 0.20293639600276947,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23903549526110388,
      "grad_norm": 0.7572331428527832,
      "learning_rate": 6.199343230248062e-06,
      "loss": 0.1835,
      "mae_dtheta": 0.014938772656023502,
      "mae_dx": 0.0022621373645961285,
      "mae_dy": 0.003974477760493755,
      "pose_mae_dtheta": 0.09119433164596558,
      "pose_mae_dx": 0.031153278425335884,
      "pose_mae_dy": 0.034706417471170425,
      "pose_rmse_dtheta": 0.19596248865127563,
      "pose_rmse_dx": 0.08781973272562027,
      "pose_rmse_dy": 0.08151782304048538,
      "pose_rmse_mean": 0.12176667898893356,
      "rmse_dtheta": 0.027832038700580597,
      "rmse_dx": 0.006795370019972324,
      "rmse_dy": 0.008821176365017891,
      "rmse_mean": 0.014482861384749413,
      "rotation_flip": 0.0076437355019152164,
      "sparse_tokens": 32089.0,
      "step": 5145,
      "turn_loss": 0.13634413480758667,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.23908195502694665,
      "grad_norm": 0.4606396555900574,
      "learning_rate": 6.198059570918656e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.046680379658937454,
      "mae_dx": 0.008538087829947472,
      "mae_dy": 0.0028728379402309656,
      "pose_mae_dtheta": 0.4064413905143738,
      "pose_mae_dx": 0.06820403784513474,
      "pose_mae_dy": 0.026668405160307884,
      "pose_rmse_dtheta": 0.6850508451461792,
      "pose_rmse_dx": 0.16063250601291656,
      "pose_rmse_dy": 0.06756657361984253,
      "pose_rmse_mean": 0.3044166564941406,
      "rmse_dtheta": 0.06757459044456482,
      "rmse_dx": 0.018671102821826935,
      "rmse_dy": 0.006673316936939955,
      "rmse_mean": 0.030973002314567566,
      "rotation_flip": 0.01549463625997305,
      "sparse_tokens": 13143.0,
      "step": 5146,
      "turn_loss": 0.2565641403198242,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.23912841479278946,
      "grad_norm": 0.41624951362609863,
      "learning_rate": 6.1967758278083026e-06,
      "loss": 0.1162,
      "mae_dtheta": 0.010387248359620571,
      "mae_dx": 0.002021136460825801,
      "mae_dy": 0.0028912487905472517,
      "pose_mae_dtheta": 0.07178311049938202,
      "pose_mae_dx": 0.024135619401931763,
      "pose_mae_dy": 0.030300062149763107,
      "pose_rmse_dtheta": 0.15585273504257202,
      "pose_rmse_dx": 0.0640442743897438,
      "pose_rmse_dy": 0.06854341924190521,
      "pose_rmse_mean": 0.09614680707454681,
      "rmse_dtheta": 0.02247682586312294,
      "rmse_dx": 0.006284759845584631,
      "rmse_dy": 0.006863823626190424,
      "rmse_mean": 0.011875136755406857,
      "rotation_flip": 0.003137606428936124,
      "sparse_tokens": 32073.0,
      "step": 5147,
      "turn_loss": 0.09605434536933899,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.23917487455863223,
      "grad_norm": 0.5702401995658875,
      "learning_rate": 6.195492001006772e-06,
      "loss": 0.1414,
      "mae_dtheta": 0.009566263295710087,
      "mae_dx": 0.0014180031139403582,
      "mae_dy": 0.0024933333043009043,
      "pose_mae_dtheta": 0.06322122365236282,
      "pose_mae_dx": 0.021553542464971542,
      "pose_mae_dy": 0.025178981944918633,
      "pose_rmse_dtheta": 0.1722155213356018,
      "pose_rmse_dx": 0.06273923814296722,
      "pose_rmse_dy": 0.06646678596735,
      "pose_rmse_mean": 0.10047385096549988,
      "rmse_dtheta": 0.02147568017244339,
      "rmse_dx": 0.0038025896064937115,
      "rmse_dy": 0.0059725879691541195,
      "rmse_mean": 0.010416952893137932,
      "rotation_flip": 0.00590086542069912,
      "sparse_tokens": 32089.0,
      "step": 5148,
      "turn_loss": 0.08797591924667358,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.239221334324475,
      "grad_norm": 0.5513088703155518,
      "learning_rate": 6.194208090603845e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.04603400453925133,
      "mae_dx": 0.009766298346221447,
      "mae_dy": 0.0037250302266329527,
      "pose_mae_dtheta": 0.3905399739742279,
      "pose_mae_dx": 0.07414857298135757,
      "pose_mae_dy": 0.035132188349962234,
      "pose_rmse_dtheta": 0.6459630131721497,
      "pose_rmse_dx": 0.15764126181602478,
      "pose_rmse_dy": 0.08371152728796005,
      "pose_rmse_mean": 0.29577192664146423,
      "rmse_dtheta": 0.06668645888566971,
      "rmse_dx": 0.01945895329117775,
      "rmse_dy": 0.007093525025993586,
      "rmse_mean": 0.031079648062586784,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 6435.0,
      "step": 5149,
      "turn_loss": 0.25770866870880127,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2392677940903178,
      "grad_norm": 0.41773247718811035,
      "learning_rate": 6.192924096689306e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.008421555161476135,
      "mae_dx": 0.001593804219737649,
      "mae_dy": 0.0022849703673273325,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4177323281764984,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 154.23219299316406,
      "model/head/act_norm_mean": 114.23353653724747,
      "model/head/act_norm_min": 59.78935241699219,
      "model/head/act_over_embed": 78.50235577961531,
      "model/head/grad_frac": 0.11022641509771347,
      "model/head/grad_norm": 0.04604513570666313,
      "model/head/grad_zero_frac": 0.00020400574430823326,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6984937263257576,
      "model/head/update_ratio": 0.0007883416838012636,
      "model/head/weight_delta": 8.399435997009277,
      "model/head/weight_delta_rel": 0.1473509818315506,
      "model/head/weight_norm": 58.40758514404297,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42012128233909607,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4200618828667535,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4199865460395813,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2886704585873408,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07175752520561218,
      "model/modality_embedder.encoders.pose/grad_norm": 0.029975438490509987,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5540972222222222,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009695054031908512,
      "model/modality_embedder.encoders.pose/weight_delta": 2.7501771450042725,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08985685557126999,
      "model/modality_embedder.encoders.pose/weight_norm": 30.91827964782715,
      "model/modality_embedder/grad_frac": 0.07175752520561218,
      "model/modality_embedder/grad_norm": 0.029975438490509987,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5540972222222222,
      "model/modality_embedder/update_ratio": 0.0009695054031908512,
      "model/modality_embedder/weight_delta": 2.7501771450042725,
      "model/modality_embedder/weight_delta_rel": 0.08985685557126999,
      "model/modality_embedder/weight_norm": 30.91827964782715,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.7262191772461,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.04019861311528,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.071969985961914,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.520649554818238,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08086103945970535,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.033778268843889236,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012142641935497522,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.0765953063964844,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07567238807678223,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.81789207458496,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.24050903320312,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.08848154160654,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.409903526306152,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.241039397456834,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08487579971551895,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0354553647339344,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012005014577880502,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.63103985786438,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09114127606153488,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.533796310424805,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.17597198486328,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.002585377585376,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.509601593017578,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.55642947366394,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09312089532613754,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.038899607956409454,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001275829621590674,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.832209587097168,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0951002985239029,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.48965835571289,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.65786743164062,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.808571829405164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.585930824279785,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.79752027126605,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11297434568405151,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04719303548336029,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015853994991630316,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.4176645278930664,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08262430131435394,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.767282485961914,
      "model/normalizer/grad_frac": 0.39520514011383057,
      "model/normalizer/grad_norm": 0.16508996486663818,
      "model/normalizer/grad_zero_frac": 0.00020207726629450917,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002105949679389596,
      "model/normalizer/weight_delta": 5.1271233558654785,
      "model/normalizer/weight_delta_rel": 0.06603437662124634,
      "model/normalizer/weight_norm": 78.39217376708984,
      "pose_mae_dtheta": 0.05435361713171005,
      "pose_mae_dx": 0.018856370821595192,
      "pose_mae_dy": 0.022903166711330414,
      "pose_rmse_dtheta": 0.14036621153354645,
      "pose_rmse_dx": 0.050168268382549286,
      "pose_rmse_dy": 0.053056567907333374,
      "pose_rmse_mean": 0.08119701594114304,
      "rmse_dtheta": 0.018967535346746445,
      "rmse_dx": 0.004513520747423172,
      "rmse_dy": 0.005179411731660366,
      "rmse_mean": 0.009553490206599236,
      "rotation_flip": 0.0031043849885463715,
      "sparse_tokens": 32121.0,
      "step": 5150,
      "turn_loss": 0.06630776077508926,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.23931425385616056,
      "grad_norm": 0.517240047454834,
      "learning_rate": 6.191640019352942e-06,
      "loss": 0.1099,
      "mae_dtheta": 0.005945325363427401,
      "mae_dx": 0.0014132572105154395,
      "mae_dy": 0.0012412266805768013,
      "pose_mae_dtheta": 0.045178014785051346,
      "pose_mae_dx": 0.014622931368649006,
      "pose_mae_dy": 0.017078902572393417,
      "pose_rmse_dtheta": 0.13515356183052063,
      "pose_rmse_dx": 0.03772812709212303,
      "pose_rmse_dy": 0.03974487632513046,
      "pose_rmse_mean": 0.07087552547454834,
      "rmse_dtheta": 0.01606256142258644,
      "rmse_dx": 0.004441201686859131,
      "rmse_dy": 0.003086918266490102,
      "rmse_mean": 0.007863560691475868,
      "rotation_flip": 0.004000000189989805,
      "sparse_tokens": 32121.0,
      "step": 5151,
      "turn_loss": 0.04892600700259209,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.23936071362200334,
      "grad_norm": 0.5347999334335327,
      "learning_rate": 6.190355858684555e-06,
      "loss": 0.1582,
      "mae_dtheta": 0.03665465489029884,
      "mae_dx": 0.00911765731871128,
      "mae_dy": 0.006213834974914789,
      "pose_mae_dtheta": 0.2711373269557953,
      "pose_mae_dx": 0.06530417501926422,
      "pose_mae_dy": 0.06154274940490723,
      "pose_rmse_dtheta": 0.4685494601726532,
      "pose_rmse_dx": 0.16339243948459625,
      "pose_rmse_dy": 0.1361500769853592,
      "pose_rmse_mean": 0.2560306787490845,
      "rmse_dtheta": 0.05471862852573395,
      "rmse_dx": 0.02016313560307026,
      "rmse_dy": 0.012775804847478867,
      "rmse_mean": 0.029219191521406174,
      "rotation_flip": 0.010277491994202137,
      "sparse_tokens": 15078.0,
      "step": 5152,
      "turn_loss": 0.32199177145957947,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.23940717338784612,
      "grad_norm": 0.5894072651863098,
      "learning_rate": 6.18907161477394e-06,
      "loss": 0.1423,
      "mae_dtheta": 0.010734587907791138,
      "mae_dx": 0.0023697647266089916,
      "mae_dy": 0.0038761403411626816,
      "pose_mae_dtheta": 0.07084442675113678,
      "pose_mae_dx": 0.034926701337099075,
      "pose_mae_dy": 0.03511788323521614,
      "pose_rmse_dtheta": 0.13844959437847137,
      "pose_rmse_dx": 0.08934479206800461,
      "pose_rmse_dy": 0.07952329516410828,
      "pose_rmse_mean": 0.10243922472000122,
      "rmse_dtheta": 0.020091719925403595,
      "rmse_dx": 0.00706459628418088,
      "rmse_dy": 0.008350676856935024,
      "rmse_mean": 0.011835664510726929,
      "rotation_flip": 0.005434782709926367,
      "sparse_tokens": 32057.0,
      "step": 5153,
      "turn_loss": 0.09967387467622757,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2394536331536889,
      "grad_norm": 0.6152787208557129,
      "learning_rate": 6.187787287710913e-06,
      "loss": 0.1371,
      "mae_dtheta": 0.01180887222290039,
      "mae_dx": 0.0014689331874251366,
      "mae_dy": 0.002505689859390259,
      "pose_mae_dtheta": 0.08243747800588608,
      "pose_mae_dx": 0.022209960967302322,
      "pose_mae_dy": 0.03200387954711914,
      "pose_rmse_dtheta": 0.21571648120880127,
      "pose_rmse_dx": 0.06195642054080963,
      "pose_rmse_dy": 0.07373794168233871,
      "pose_rmse_mean": 0.11713694781064987,
      "rmse_dtheta": 0.02608192153275013,
      "rmse_dx": 0.004078094847500324,
      "rmse_dy": 0.0057718949392437935,
      "rmse_mean": 0.01197730377316475,
      "rotation_flip": 0.003750937758013606,
      "sparse_tokens": 32073.0,
      "step": 5154,
      "turn_loss": 0.08842681348323822,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.2395000929195317,
      "grad_norm": 0.5778064131736755,
      "learning_rate": 6.186502877585281e-06,
      "loss": 0.1615,
      "mae_dtheta": 0.027862243354320526,
      "mae_dx": 0.009722281247377396,
      "mae_dy": 0.007078902330249548,
      "pose_mae_dtheta": 0.24473564326763153,
      "pose_mae_dx": 0.13109734654426575,
      "pose_mae_dy": 0.06622800976037979,
      "pose_rmse_dtheta": 0.3827555775642395,
      "pose_rmse_dx": 0.23843666911125183,
      "pose_rmse_dy": 0.14635899662971497,
      "pose_rmse_mean": 0.2558504045009613,
      "rmse_dtheta": 0.04321238398551941,
      "rmse_dx": 0.01917979121208191,
      "rmse_dy": 0.012937566265463829,
      "rmse_mean": 0.02510991506278515,
      "rotation_flip": 0.012396694160997868,
      "sparse_tokens": 3900.0,
      "step": 5155,
      "turn_loss": 0.32145676016807556,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 34713.0,
      "epoch": 0.23954655268537448,
      "grad_norm": 0.5913710594177246,
      "learning_rate": 6.185218384486866e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.027276095002889633,
      "mae_dx": 0.01204926148056984,
      "mae_dy": 0.003684970084577799,
      "pose_mae_dtheta": 0.21205061674118042,
      "pose_mae_dx": 0.09701918810606003,
      "pose_mae_dy": 0.050397396087646484,
      "pose_rmse_dtheta": 0.39998605847358704,
      "pose_rmse_dx": 0.2213391810655594,
      "pose_rmse_dy": 0.13772383332252502,
      "pose_rmse_mean": 0.2530163526535034,
      "rmse_dtheta": 0.04521678760647774,
      "rmse_dx": 0.024769878014922142,
      "rmse_dy": 0.007588785607367754,
      "rmse_mean": 0.025858484208583832,
      "rotation_flip": 0.007973422296345234,
      "sparse_tokens": 25785.0,
      "step": 5156,
      "turn_loss": 0.23183968663215637,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.23959301245121725,
      "grad_norm": 0.47854307293891907,
      "learning_rate": 6.183933808505495e-06,
      "loss": 0.0935,
      "mae_dtheta": 0.02589687705039978,
      "mae_dx": 0.011845337226986885,
      "mae_dy": 0.002774197841063142,
      "pose_mae_dtheta": 0.19908608496189117,
      "pose_mae_dx": 0.0913969874382019,
      "pose_mae_dy": 0.03162384033203125,
      "pose_rmse_dtheta": 0.36210599541664124,
      "pose_rmse_dx": 0.22374367713928223,
      "pose_rmse_dy": 0.07463770359754562,
      "pose_rmse_mean": 0.22016245126724243,
      "rmse_dtheta": 0.04176178574562073,
      "rmse_dx": 0.024233359843492508,
      "rmse_dy": 0.005648105870932341,
      "rmse_mean": 0.023881083354353905,
      "rotation_flip": 0.003418803447857499,
      "sparse_tokens": 8542.0,
      "step": 5157,
      "turn_loss": 0.19250181317329407,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.23963947221706003,
      "grad_norm": 0.5103943347930908,
      "learning_rate": 6.182649149730997e-06,
      "loss": 0.1064,
      "mae_dtheta": 0.010510283522307873,
      "mae_dx": 0.002104561310261488,
      "mae_dy": 0.0014808750711381435,
      "pose_mae_dtheta": 0.07393425703048706,
      "pose_mae_dx": 0.02085811085999012,
      "pose_mae_dy": 0.017503781244158745,
      "pose_rmse_dtheta": 0.22569730877876282,
      "pose_rmse_dx": 0.05254211649298668,
      "pose_rmse_dy": 0.054563432931900024,
      "pose_rmse_mean": 0.1109342873096466,
      "rmse_dtheta": 0.02745305560529232,
      "rmse_dx": 0.0060090599581599236,
      "rmse_dy": 0.0037091076374053955,
      "rmse_mean": 0.012390407733619213,
      "rotation_flip": 0.002795527223497629,
      "sparse_tokens": 32233.0,
      "step": 5158,
      "turn_loss": 0.08735443651676178,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35363.0,
      "epoch": 0.2396859319829028,
      "grad_norm": 0.48249879479408264,
      "learning_rate": 6.181364408253209e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.03503795340657234,
      "mae_dx": 0.010205564089119434,
      "mae_dy": 0.004798360168933868,
      "pose_mae_dtheta": 0.28387629985809326,
      "pose_mae_dx": 0.07505643367767334,
      "pose_mae_dy": 0.05079132691025734,
      "pose_rmse_dtheta": 0.4851108193397522,
      "pose_rmse_dx": 0.18487878143787384,
      "pose_rmse_dy": 0.1342792809009552,
      "pose_rmse_mean": 0.26808962225914,
      "rmse_dtheta": 0.052991706877946854,
      "rmse_dx": 0.021852651610970497,
      "rmse_dy": 0.011375735513865948,
      "rmse_mean": 0.028740031644701958,
      "rotation_flip": 0.00999375432729721,
      "sparse_tokens": 27420.0,
      "step": 5159,
      "turn_loss": 0.241118922829628,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.23973239174874558,
      "grad_norm": 1.0896440744400024,
      "learning_rate": 6.180079584161971e-06,
      "loss": 0.3407,
      "mae_dtheta": 0.04108845070004463,
      "mae_dx": 0.016217919066548347,
      "mae_dy": 0.005733332596719265,
      "pose_mae_dtheta": 0.3516121506690979,
      "pose_mae_dx": 0.12347839772701263,
      "pose_mae_dy": 0.08147739619016647,
      "pose_rmse_dtheta": 0.531745970249176,
      "pose_rmse_dx": 0.2465265840291977,
      "pose_rmse_dy": 0.20483574271202087,
      "pose_rmse_mean": 0.32770276069641113,
      "rmse_dtheta": 0.05768277496099472,
      "rmse_dx": 0.029084378853440285,
      "rmse_dy": 0.010908151045441628,
      "rmse_mean": 0.03255843371152878,
      "rotation_flip": 0.014662756584584713,
      "sparse_tokens": 10444.0,
      "step": 5160,
      "turn_loss": 0.35296788811683655,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.23977885151458836,
      "grad_norm": 0.42837855219841003,
      "learning_rate": 6.178794677547138e-06,
      "loss": 0.0815,
      "mae_dtheta": 0.02486984245479107,
      "mae_dx": 0.0072891018353402615,
      "mae_dy": 0.0024370939936488867,
      "pose_mae_dtheta": 0.20073403418064117,
      "pose_mae_dx": 0.05138900503516197,
      "pose_mae_dy": 0.01761915720999241,
      "pose_rmse_dtheta": 0.3702206611633301,
      "pose_rmse_dx": 0.13088661432266235,
      "pose_rmse_dy": 0.03583233058452606,
      "pose_rmse_mean": 0.17897987365722656,
      "rmse_dtheta": 0.040370821952819824,
      "rmse_dx": 0.017047490924596786,
      "rmse_dy": 0.004493910353630781,
      "rmse_mean": 0.020637407898902893,
      "rotation_flip": 0.013333333656191826,
      "sparse_tokens": 8754.0,
      "step": 5161,
      "turn_loss": 0.18362317979335785,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.23982531128043114,
      "grad_norm": 0.5534573793411255,
      "learning_rate": 6.177509688498558e-06,
      "loss": 0.1609,
      "mae_dtheta": 0.01941939815878868,
      "mae_dx": 0.006822885479778051,
      "mae_dy": 0.0058355615474283695,
      "pose_mae_dtheta": 0.15402637422084808,
      "pose_mae_dx": 0.04763926565647125,
      "pose_mae_dy": 0.038470033556222916,
      "pose_rmse_dtheta": 0.380887508392334,
      "pose_rmse_dx": 0.12598904967308044,
      "pose_rmse_dy": 0.0914025530219078,
      "pose_rmse_mean": 0.19942638278007507,
      "rmse_dtheta": 0.04195408523082733,
      "rmse_dx": 0.017075080424547195,
      "rmse_dy": 0.015047753229737282,
      "rmse_mean": 0.02469230815768242,
      "rotation_flip": 0.012005649507045746,
      "sparse_tokens": 32217.0,
      "step": 5162,
      "turn_loss": 0.2367991954088211,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.23987177104627394,
      "grad_norm": 0.6186718940734863,
      "learning_rate": 6.176224617106094e-06,
      "loss": 0.1435,
      "mae_dtheta": 0.011883213184773922,
      "mae_dx": 0.003689837409183383,
      "mae_dy": 0.0033958572894334793,
      "pose_mae_dtheta": 0.09074521064758301,
      "pose_mae_dx": 0.046222835779190063,
      "pose_mae_dy": 0.038187578320503235,
      "pose_rmse_dtheta": 0.26032355427742004,
      "pose_rmse_dx": 0.1422031968832016,
      "pose_rmse_dy": 0.10881444811820984,
      "pose_rmse_mean": 0.17044708132743835,
      "rmse_dtheta": 0.028881458565592766,
      "rmse_dx": 0.011400663293898106,
      "rmse_dy": 0.008926477283239365,
      "rmse_mean": 0.016402866691350937,
      "rotation_flip": 0.005211047362536192,
      "sparse_tokens": 32041.0,
      "step": 5163,
      "turn_loss": 0.13417473435401917,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.23991823081211672,
      "grad_norm": 0.8859134316444397,
      "learning_rate": 6.174939463459612e-06,
      "loss": 0.2548,
      "mae_dtheta": 0.034480705857276917,
      "mae_dx": 0.01757989078760147,
      "mae_dy": 0.007559570018202066,
      "pose_mae_dtheta": 0.2574242651462555,
      "pose_mae_dx": 0.16004681587219238,
      "pose_mae_dy": 0.08852321654558182,
      "pose_rmse_dtheta": 0.42920804023742676,
      "pose_rmse_dx": 0.3105246126651764,
      "pose_rmse_dy": 0.19331547617912292,
      "pose_rmse_mean": 0.3110160529613495,
      "rmse_dtheta": 0.05009017139673233,
      "rmse_dx": 0.03087015636265278,
      "rmse_dy": 0.014475648291409016,
      "rmse_mean": 0.031811993569135666,
      "rotation_flip": 0.008948545902967453,
      "sparse_tokens": 7444.0,
      "step": 5164,
      "turn_loss": 0.32128289341926575,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.2399646905779595,
      "grad_norm": 0.5121406316757202,
      "learning_rate": 6.173654227648983e-06,
      "loss": 0.1288,
      "mae_dtheta": 0.03619898483157158,
      "mae_dx": 0.01170362252742052,
      "mae_dy": 0.004902741406112909,
      "pose_mae_dtheta": 0.26381656527519226,
      "pose_mae_dx": 0.09659480303525925,
      "pose_mae_dy": 0.057547327131032944,
      "pose_rmse_dtheta": 0.47723522782325745,
      "pose_rmse_dx": 0.20955605804920197,
      "pose_rmse_dy": 0.10989248752593994,
      "pose_rmse_mean": 0.2655612826347351,
      "rmse_dtheta": 0.05419003218412399,
      "rmse_dx": 0.023434704169631004,
      "rmse_dy": 0.008144360035657883,
      "rmse_mean": 0.028589701279997826,
      "rotation_flip": 0.008860759437084198,
      "sparse_tokens": 13126.0,
      "step": 5165,
      "turn_loss": 0.2971920967102051,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.24001115034380227,
      "grad_norm": 0.35331904888153076,
      "learning_rate": 6.1723689097640815e-06,
      "loss": 0.0842,
      "mae_dtheta": 0.009601479396224022,
      "mae_dx": 0.0016403690678998828,
      "mae_dy": 0.00136990484315902,
      "pose_mae_dtheta": 0.07334283739328384,
      "pose_mae_dx": 0.016374779865145683,
      "pose_mae_dy": 0.01732245646417141,
      "pose_rmse_dtheta": 0.22777053713798523,
      "pose_rmse_dx": 0.04075099900364876,
      "pose_rmse_dy": 0.04493280127644539,
      "pose_rmse_mean": 0.10448478907346725,
      "rmse_dtheta": 0.02724607102572918,
      "rmse_dx": 0.0049137212336063385,
      "rmse_dy": 0.00324853858910501,
      "rmse_mean": 0.011802776716649532,
      "rotation_flip": 0.0025201612152159214,
      "sparse_tokens": 32153.0,
      "step": 5166,
      "turn_loss": 0.07348021119832993,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24005761010964505,
      "grad_norm": 0.32706746459007263,
      "learning_rate": 6.171083509894795e-06,
      "loss": 0.0977,
      "mae_dtheta": 0.010812390595674515,
      "mae_dx": 0.0014327880926430225,
      "mae_dy": 0.0020087873563170433,
      "pose_mae_dtheta": 0.06401228904724121,
      "pose_mae_dx": 0.019997719675302505,
      "pose_mae_dy": 0.02535826712846756,
      "pose_rmse_dtheta": 0.14957691729068756,
      "pose_rmse_dx": 0.046140577644109726,
      "pose_rmse_dy": 0.05289233475923538,
      "pose_rmse_mean": 0.08286994695663452,
      "rmse_dtheta": 0.022994639351963997,
      "rmse_dx": 0.0044251056388020515,
      "rmse_dy": 0.003986101131886244,
      "rmse_mean": 0.010468616150319576,
      "rotation_flip": 0.002527075819671154,
      "sparse_tokens": 32121.0,
      "step": 5167,
      "turn_loss": 0.07673518359661102,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.24010406987548782,
      "grad_norm": 0.4660431146621704,
      "learning_rate": 6.1697980281310096e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.009298465214669704,
      "mae_dx": 0.0024792884942144156,
      "mae_dy": 0.002085495973005891,
      "pose_mae_dtheta": 0.06423863768577576,
      "pose_mae_dx": 0.02556833252310753,
      "pose_mae_dy": 0.02498403564095497,
      "pose_rmse_dtheta": 0.18593767285346985,
      "pose_rmse_dx": 0.08652039617300034,
      "pose_rmse_dy": 0.08548247814178467,
      "pose_rmse_mean": 0.11931352317333221,
      "rmse_dtheta": 0.024601586163043976,
      "rmse_dx": 0.008419112302362919,
      "rmse_dy": 0.007891549728810787,
      "rmse_mean": 0.013637416064739227,
      "rotation_flip": 0.009340659715235233,
      "sparse_tokens": 32105.0,
      "step": 5168,
      "turn_loss": 0.08753947913646698,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2401505296413306,
      "grad_norm": 0.6939125657081604,
      "learning_rate": 6.16851246456262e-06,
      "loss": 0.1148,
      "mae_dtheta": 0.007355211768299341,
      "mae_dx": 0.0013054957380518317,
      "mae_dy": 0.0007468241383321583,
      "pose_mae_dtheta": 0.05257684364914894,
      "pose_mae_dx": 0.014559829607605934,
      "pose_mae_dy": 0.01116857398301363,
      "pose_rmse_dtheta": 0.21104887127876282,
      "pose_rmse_dx": 0.03848116099834442,
      "pose_rmse_dy": 0.03227153792977333,
      "pose_rmse_mean": 0.09393386542797089,
      "rmse_dtheta": 0.02431369386613369,
      "rmse_dx": 0.004208901897072792,
      "rmse_dy": 0.0018311513122171164,
      "rmse_mean": 0.010117916390299797,
      "rotation_flip": 0.0012507817009463906,
      "sparse_tokens": 32105.0,
      "step": 5169,
      "turn_loss": 0.04795348644256592,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.24019698940717338,
      "grad_norm": 0.43737462162971497,
      "learning_rate": 6.1672268192795285e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.026238448917865753,
      "mae_dx": 0.011909155175089836,
      "mae_dy": 0.004529986530542374,
      "pose_mae_dtheta": 0.19886918365955353,
      "pose_mae_dx": 0.09284818172454834,
      "pose_mae_dy": 0.0505184605717659,
      "pose_rmse_dtheta": 0.40602412819862366,
      "pose_rmse_dx": 0.22694352269172668,
      "pose_rmse_dy": 0.15280336141586304,
      "pose_rmse_mean": 0.2619236707687378,
      "rmse_dtheta": 0.04510064050555229,
      "rmse_dx": 0.025615602731704712,
      "rmse_dy": 0.009856847114861012,
      "rmse_mean": 0.02685770019888878,
      "rotation_flip": 0.008908686228096485,
      "sparse_tokens": 9547.0,
      "step": 5170,
      "turn_loss": 0.1883179396390915,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.24024344917301615,
      "grad_norm": 0.3620956838130951,
      "learning_rate": 6.165941092371637e-06,
      "loss": 0.0822,
      "mae_dtheta": 0.009481571614742279,
      "mae_dx": 0.0017755524022504687,
      "mae_dy": 0.0024877970572561026,
      "pose_mae_dtheta": 0.06302613765001297,
      "pose_mae_dx": 0.023148026317358017,
      "pose_mae_dy": 0.024704867973923683,
      "pose_rmse_dtheta": 0.164144828915596,
      "pose_rmse_dx": 0.06165434792637825,
      "pose_rmse_dy": 0.058453839272260666,
      "pose_rmse_mean": 0.09475100040435791,
      "rmse_dtheta": 0.022356394678354263,
      "rmse_dx": 0.00546356663107872,
      "rmse_dy": 0.0057844435796141624,
      "rmse_mean": 0.011201469227671623,
      "rotation_flip": 0.005033556837588549,
      "sparse_tokens": 32089.0,
      "step": 5171,
      "turn_loss": 0.07686396688222885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.24028990893885896,
      "grad_norm": 0.5380040407180786,
      "learning_rate": 6.164655283928859e-06,
      "loss": 0.1734,
      "mae_dtheta": 0.05410885810852051,
      "mae_dx": 0.0067919460125267506,
      "mae_dy": 0.005010150372982025,
      "pose_mae_dtheta": 0.45627057552337646,
      "pose_mae_dx": 0.05823995918035507,
      "pose_mae_dy": 0.05488823354244232,
      "pose_rmse_dtheta": 0.8144230246543884,
      "pose_rmse_dx": 0.1499233841896057,
      "pose_rmse_dy": 0.13382358849048615,
      "pose_rmse_mean": 0.3660566806793213,
      "rmse_dtheta": 0.07934993505477905,
      "rmse_dx": 0.01552139688283205,
      "rmse_dy": 0.010973090305924416,
      "rmse_mean": 0.0352814756333828,
      "rotation_flip": 0.0060606058686971664,
      "sparse_tokens": 3115.0,
      "step": 5172,
      "turn_loss": 0.16822057962417603,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 26607.0,
      "epoch": 0.24033636870470174,
      "grad_norm": 0.5633581280708313,
      "learning_rate": 6.163369394041112e-06,
      "loss": 0.2198,
      "mae_dtheta": 0.03239317238330841,
      "mae_dx": 0.009348220191895962,
      "mae_dy": 0.00743434252217412,
      "pose_mae_dtheta": 0.2540689706802368,
      "pose_mae_dx": 0.06287992745637894,
      "pose_mae_dy": 0.07959329336881638,
      "pose_rmse_dtheta": 0.47706928849220276,
      "pose_rmse_dx": 0.12034294754266739,
      "pose_rmse_dy": 0.18238630890846252,
      "pose_rmse_mean": 0.25993284583091736,
      "rmse_dtheta": 0.05251377820968628,
      "rmse_dx": 0.019640197977423668,
      "rmse_dy": 0.015865258872509003,
      "rmse_mean": 0.0293397456407547,
      "rotation_flip": 0.01045856811106205,
      "sparse_tokens": 21635.0,
      "step": 5173,
      "turn_loss": 0.26965200901031494,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.2403828284705445,
      "grad_norm": 0.5244070887565613,
      "learning_rate": 6.162083422798319e-06,
      "loss": 0.1268,
      "mae_dtheta": 0.03214003145694733,
      "mae_dx": 0.013406733050942421,
      "mae_dy": 0.004002858884632587,
      "pose_mae_dtheta": 0.24658465385437012,
      "pose_mae_dx": 0.11120155453681946,
      "pose_mae_dy": 0.03956158086657524,
      "pose_rmse_dtheta": 0.42015233635902405,
      "pose_rmse_dx": 0.23545996844768524,
      "pose_rmse_dy": 0.09830588847398758,
      "pose_rmse_mean": 0.25130605697631836,
      "rmse_dtheta": 0.049935221672058105,
      "rmse_dx": 0.0253018569201231,
      "rmse_dy": 0.009482833556830883,
      "rmse_mean": 0.02823997102677822,
      "rotation_flip": 0.009493670426309109,
      "sparse_tokens": 10077.0,
      "step": 5174,
      "turn_loss": 0.23668484389781952,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 32986.0,
      "epoch": 0.2404292882363873,
      "grad_norm": 0.5983069539070129,
      "learning_rate": 6.1607973702904086e-06,
      "loss": 0.1795,
      "mae_dtheta": 0.02803771197795868,
      "mae_dx": 0.00984353106468916,
      "mae_dy": 0.00471701892092824,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5983069539070129,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.3686065673828,
      "model/head/act_norm_mean": 114.34939874387256,
      "model/head/act_norm_min": 72.9013442993164,
      "model/head/act_over_embed": 78.58197737272714,
      "model/head/grad_frac": 0.12326760590076447,
      "model/head/grad_norm": 0.07375186681747437,
      "model/head/grad_zero_frac": 0.00014055139035917819,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6969688265931373,
      "model/head/update_ratio": 0.0012626235838979483,
      "model/head/weight_delta": 8.419758796691895,
      "model/head/weight_delta_rel": 0.1477075070142746,
      "model/head/weight_norm": 58.41160202026367,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42002514004707336,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42002514004707336,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42002514004707336,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2886452085776649,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07440906018018723,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04451945796608925,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014398846542462707,
      "model/modality_embedder.encoders.pose/weight_delta": 2.7545464038848877,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.08999961614608765,
      "model/modality_embedder.encoders.pose/weight_norm": 30.91876792907715,
      "model/modality_embedder/grad_frac": 0.07440906018018723,
      "model/modality_embedder/grad_norm": 0.04451945796608925,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0014398846542462707,
      "model/modality_embedder/weight_delta": 2.7545464038848877,
      "model/modality_embedder/weight_delta_rel": 0.08999961614608765,
      "model/modality_embedder/weight_norm": 30.91876792907715,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.40476989746094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.01197284469343,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.15314769744873,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.501252542504936,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08172206580638885,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04889488220214844,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017575756646692753,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.0831222534179688,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07591023296117783,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.819503784179688,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.27568817138672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.855375136165577,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.615217208862305,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.08084649326125,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07997194677591324,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.047847773879766464,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001619945396669209,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.6400365829467773,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.0914529338479042,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.536659240722656,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.01171112060547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.488221677559913,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.98636531829834,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.20295392345761,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07144627720117569,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.042746804654598236,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014018778456375003,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.841419219970703,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09540953487157822,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.49253273010254,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.30797576904297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.382457496887643,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.881656646728516,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.504690512614772,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06786812096834183,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04060596972703934,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013639729004353285,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.4264535903930664,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08292467147111893,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.77036476135254,
      "model/normalizer/grad_frac": 0.23832851648330688,
      "model/normalizer/grad_norm": 0.1425936073064804,
      "model/normalizer/grad_zero_frac": 0.00017253380792681128,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018188985995948315,
      "model/normalizer/weight_delta": 5.144311904907227,
      "model/normalizer/weight_delta_rel": 0.06625575572252274,
      "model/normalizer/weight_norm": 78.39557647705078,
      "pose_mae_dtheta": 0.22077082097530365,
      "pose_mae_dx": 0.07777538150548935,
      "pose_mae_dy": 0.06268154829740524,
      "pose_rmse_dtheta": 0.3890312612056732,
      "pose_rmse_dx": 0.18313159048557281,
      "pose_rmse_dy": 0.14430473744869232,
      "pose_rmse_mean": 0.2388225495815277,
      "rmse_dtheta": 0.044064365327358246,
      "rmse_dx": 0.02175539918243885,
      "rmse_dy": 0.009160985238850117,
      "rmse_mean": 0.02499358355998993,
      "rotation_flip": 0.014105419628322124,
      "sparse_tokens": 26555.0,
      "step": 5175,
      "turn_loss": 0.2400156408548355,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.24047574800223007,
      "grad_norm": 0.6661843061447144,
      "learning_rate": 6.1595112366073164e-06,
      "loss": 0.1807,
      "mae_dtheta": 0.00802796334028244,
      "mae_dx": 0.0014678415609523654,
      "mae_dy": 0.0008835229091346264,
      "pose_mae_dtheta": 0.055576808750629425,
      "pose_mae_dx": 0.014302783645689487,
      "pose_mae_dy": 0.013707475736737251,
      "pose_rmse_dtheta": 0.18505153059959412,
      "pose_rmse_dx": 0.03505982831120491,
      "pose_rmse_dy": 0.03575383499264717,
      "pose_rmse_mean": 0.0852883979678154,
      "rmse_dtheta": 0.024590635672211647,
      "rmse_dx": 0.004691751208156347,
      "rmse_dy": 0.0021400523837655783,
      "rmse_mean": 0.010474147275090218,
      "rotation_flip": 0.00296296295709908,
      "sparse_tokens": 32153.0,
      "step": 5176,
      "turn_loss": 0.051013581454753876,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24052220776807284,
      "grad_norm": 0.5376911759376526,
      "learning_rate": 6.158225021838981e-06,
      "loss": 0.1139,
      "mae_dtheta": 0.009434024803340435,
      "mae_dx": 0.00133905082475394,
      "mae_dy": 0.0020872524473816156,
      "pose_mae_dtheta": 0.06186399981379509,
      "pose_mae_dx": 0.019587818533182144,
      "pose_mae_dy": 0.026480386033654213,
      "pose_rmse_dtheta": 0.13941837847232819,
      "pose_rmse_dx": 0.05222102627158165,
      "pose_rmse_dy": 0.0637359470129013,
      "pose_rmse_mean": 0.08512511849403381,
      "rmse_dtheta": 0.019831040874123573,
      "rmse_dx": 0.0042507401667535305,
      "rmse_dy": 0.004526613745838404,
      "rmse_mean": 0.009536132216453552,
      "rotation_flip": 0.006589785683900118,
      "sparse_tokens": 32073.0,
      "step": 5177,
      "turn_loss": 0.07134834676980972,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.24056866753391562,
      "grad_norm": 0.6522935628890991,
      "learning_rate": 6.1569387260753465e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.01032182201743126,
      "mae_dx": 0.0022094587329775095,
      "mae_dy": 0.0033811265602707863,
      "pose_mae_dtheta": 0.07158613950014114,
      "pose_mae_dx": 0.030749108642339706,
      "pose_mae_dy": 0.03241567686200142,
      "pose_rmse_dtheta": 0.1624012440443039,
      "pose_rmse_dx": 0.06890901178121567,
      "pose_rmse_dy": 0.07053840160369873,
      "pose_rmse_mean": 0.1006162166595459,
      "rmse_dtheta": 0.021386098116636276,
      "rmse_dx": 0.005582125391811132,
      "rmse_dy": 0.00736589077860117,
      "rmse_mean": 0.011444705538451672,
      "rotation_flip": 0.005332496948540211,
      "sparse_tokens": 32137.0,
      "step": 5178,
      "turn_loss": 0.10441481322050095,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2406151272997584,
      "grad_norm": 0.7746800184249878,
      "learning_rate": 6.155652349406366e-06,
      "loss": 0.1656,
      "mae_dtheta": 0.011008810251951218,
      "mae_dx": 0.002084607956930995,
      "mae_dy": 0.0029888779390603304,
      "pose_mae_dtheta": 0.07995893806219101,
      "pose_mae_dx": 0.03080892376601696,
      "pose_mae_dy": 0.03394928574562073,
      "pose_rmse_dtheta": 0.18767081201076508,
      "pose_rmse_dx": 0.06902438402175903,
      "pose_rmse_dy": 0.08403385430574417,
      "pose_rmse_mean": 0.11357635259628296,
      "rmse_dtheta": 0.022869452834129333,
      "rmse_dx": 0.005209655035287142,
      "rmse_dy": 0.006216968409717083,
      "rmse_mean": 0.011432025581598282,
      "rotation_flip": 0.0068605029955506325,
      "sparse_tokens": 32137.0,
      "step": 5179,
      "turn_loss": 0.08701195567846298,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.2406615870656012,
      "grad_norm": 0.5255283117294312,
      "learning_rate": 6.154365891921997e-06,
      "loss": 0.123,
      "mae_dtheta": 0.006981967948377132,
      "mae_dx": 0.0011502302950248122,
      "mae_dy": 0.0005086089367978275,
      "pose_mae_dtheta": 0.050777364522218704,
      "pose_mae_dx": 0.009997864253818989,
      "pose_mae_dy": 0.008836000226438046,
      "pose_rmse_dtheta": 0.2149188071489334,
      "pose_rmse_dx": 0.021408066153526306,
      "pose_rmse_dy": 0.027037814259529114,
      "pose_rmse_mean": 0.08778822422027588,
      "rmse_dtheta": 0.0257367305457592,
      "rmse_dx": 0.003331707092002034,
      "rmse_dy": 0.001185380737297237,
      "rmse_mean": 0.0100846067070961,
      "rotation_flip": 0.0010152284521609545,
      "sparse_tokens": 32201.0,
      "step": 5180,
      "turn_loss": 0.04563770815730095,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.24070804683144398,
      "grad_norm": 0.6426872611045837,
      "learning_rate": 6.153079353712201e-06,
      "loss": 0.0773,
      "mae_dtheta": 0.0113670127466321,
      "mae_dx": 0.0024082886520773172,
      "mae_dy": 0.003632262349128723,
      "pose_mae_dtheta": 0.07672403752803802,
      "pose_mae_dx": 0.030190054327249527,
      "pose_mae_dy": 0.03624085336923599,
      "pose_rmse_dtheta": 0.15474900603294373,
      "pose_rmse_dx": 0.09138038009405136,
      "pose_rmse_dy": 0.07898952066898346,
      "pose_rmse_mean": 0.10837297141551971,
      "rmse_dtheta": 0.02164449170231819,
      "rmse_dx": 0.006667963229119778,
      "rmse_dy": 0.008606505580246449,
      "rmse_mean": 0.01230632048100233,
      "rotation_flip": 0.010530421510338783,
      "sparse_tokens": 32089.0,
      "step": 5181,
      "turn_loss": 0.10207152366638184,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.24075450659728675,
      "grad_norm": 0.6230953335762024,
      "learning_rate": 6.151792734866948e-06,
      "loss": 0.1136,
      "mae_dtheta": 0.01122291013598442,
      "mae_dx": 0.0018135494319722056,
      "mae_dy": 0.0026875250041484833,
      "pose_mae_dtheta": 0.07860763370990753,
      "pose_mae_dx": 0.021955398842692375,
      "pose_mae_dy": 0.031629778444767,
      "pose_rmse_dtheta": 0.2005881816148758,
      "pose_rmse_dx": 0.059614188969135284,
      "pose_rmse_dy": 0.07356350868940353,
      "pose_rmse_mean": 0.11125530302524567,
      "rmse_dtheta": 0.02492079697549343,
      "rmse_dx": 0.0057754358276724815,
      "rmse_dy": 0.006182411685585976,
      "rmse_mean": 0.012292882427573204,
      "rotation_flip": 0.009285051375627518,
      "sparse_tokens": 32057.0,
      "step": 5182,
      "turn_loss": 0.09036809951066971,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.24080096636312953,
      "grad_norm": 0.6979552507400513,
      "learning_rate": 6.15050603547621e-06,
      "loss": 0.0905,
      "mae_dtheta": 0.011624638922512531,
      "mae_dx": 0.0028459555469453335,
      "mae_dy": 0.003948655445128679,
      "pose_mae_dtheta": 0.07833536714315414,
      "pose_mae_dx": 0.03650544211268425,
      "pose_mae_dy": 0.03845544904470444,
      "pose_rmse_dtheta": 0.16231265664100647,
      "pose_rmse_dx": 0.0866343304514885,
      "pose_rmse_dy": 0.0947592630982399,
      "pose_rmse_mean": 0.11456875503063202,
      "rmse_dtheta": 0.022549714893102646,
      "rmse_dx": 0.00782550498843193,
      "rmse_dy": 0.00930244941264391,
      "rmse_mean": 0.013225889764726162,
      "rotation_flip": 0.006738544441759586,
      "sparse_tokens": 32137.0,
      "step": 5183,
      "turn_loss": 0.12030814588069916,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31143.0,
      "epoch": 0.2408474261289723,
      "grad_norm": 1.1123319864273071,
      "learning_rate": 6.149219255629969e-06,
      "loss": 0.2379,
      "mae_dtheta": 0.031137200072407722,
      "mae_dx": 0.010481441393494606,
      "mae_dy": 0.005032464396208525,
      "pose_mae_dtheta": 0.23959125578403473,
      "pose_mae_dx": 0.0945713147521019,
      "pose_mae_dy": 0.06460720300674438,
      "pose_rmse_dtheta": 0.4612666368484497,
      "pose_rmse_dx": 0.22690658271312714,
      "pose_rmse_dy": 0.14701423048973083,
      "pose_rmse_mean": 0.2783958315849304,
      "rmse_dtheta": 0.05075439438223839,
      "rmse_dx": 0.02387048676609993,
      "rmse_dy": 0.01099349558353424,
      "rmse_mean": 0.02853946015238762,
      "rotation_flip": 0.0069252075627446175,
      "sparse_tokens": 23568.0,
      "step": 5184,
      "turn_loss": 0.265882283449173,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.24089388589481509,
      "grad_norm": 0.6467754244804382,
      "learning_rate": 6.1479323954182055e-06,
      "loss": 0.1742,
      "mae_dtheta": 0.03646715357899666,
      "mae_dx": 0.012892119586467743,
      "mae_dy": 0.0039724064990878105,
      "pose_mae_dtheta": 0.2850680947303772,
      "pose_mae_dx": 0.10253123939037323,
      "pose_mae_dy": 0.05153435468673706,
      "pose_rmse_dtheta": 0.48553958535194397,
      "pose_rmse_dx": 0.21524155139923096,
      "pose_rmse_dy": 0.12037729471921921,
      "pose_rmse_mean": 0.2737194895744324,
      "rmse_dtheta": 0.05395592004060745,
      "rmse_dx": 0.025326430797576904,
      "rmse_dy": 0.008311353623867035,
      "rmse_mean": 0.029197901487350464,
      "rotation_flip": 0.012241054326295853,
      "sparse_tokens": 18522.0,
      "step": 5185,
      "turn_loss": 0.267244428396225,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.24094034566065786,
      "grad_norm": 0.5497075319290161,
      "learning_rate": 6.146645454930916e-06,
      "loss": 0.1632,
      "mae_dtheta": 0.03923582658171654,
      "mae_dx": 0.010156825184822083,
      "mae_dy": 0.0038857602048665285,
      "pose_mae_dtheta": 0.32949116826057434,
      "pose_mae_dx": 0.08559674769639969,
      "pose_mae_dy": 0.053886108100414276,
      "pose_rmse_dtheta": 0.5175163745880127,
      "pose_rmse_dx": 0.19910724461078644,
      "pose_rmse_dy": 0.14340506494045258,
      "pose_rmse_mean": 0.28667622804641724,
      "rmse_dtheta": 0.054950371384620667,
      "rmse_dx": 0.022357147186994553,
      "rmse_dy": 0.007898551411926746,
      "rmse_mean": 0.028402026742696762,
      "rotation_flip": 0.007915567606687546,
      "sparse_tokens": 18388.0,
      "step": 5186,
      "turn_loss": 0.3211503326892853,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24098680542650064,
      "grad_norm": 0.5145270228385925,
      "learning_rate": 6.145358434258094e-06,
      "loss": 0.1603,
      "mae_dtheta": 0.011896366253495216,
      "mae_dx": 0.004079681821167469,
      "mae_dy": 0.004624605178833008,
      "pose_mae_dtheta": 0.0827418714761734,
      "pose_mae_dx": 0.04408346116542816,
      "pose_mae_dy": 0.04491136223077774,
      "pose_rmse_dtheta": 0.16955432295799255,
      "pose_rmse_dx": 0.11510644853115082,
      "pose_rmse_dy": 0.14384154975414276,
      "pose_rmse_mean": 0.1428341120481491,
      "rmse_dtheta": 0.02333364635705948,
      "rmse_dx": 0.01167982630431652,
      "rmse_dy": 0.012211904861032963,
      "rmse_mean": 0.01574179343879223,
      "rotation_flip": 0.005939124152064323,
      "sparse_tokens": 32121.0,
      "step": 5187,
      "turn_loss": 0.13236390054225922,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.24103326519234344,
      "grad_norm": 1.125739574432373,
      "learning_rate": 6.144071333489742e-06,
      "loss": 0.2573,
      "mae_dtheta": 0.03957263007760048,
      "mae_dx": 0.012731272727251053,
      "mae_dy": 0.004217657260596752,
      "pose_mae_dtheta": 0.3513377010822296,
      "pose_mae_dx": 0.10031676292419434,
      "pose_mae_dy": 0.046934716403484344,
      "pose_rmse_dtheta": 0.6120026707649231,
      "pose_rmse_dx": 0.24802212417125702,
      "pose_rmse_dy": 0.11615728586912155,
      "pose_rmse_mean": 0.32539403438568115,
      "rmse_dtheta": 0.06053020805120468,
      "rmse_dx": 0.026882076635956764,
      "rmse_dy": 0.008842118084430695,
      "rmse_mean": 0.03208480030298233,
      "rotation_flip": 0.00374531839042902,
      "sparse_tokens": 11608.0,
      "step": 5188,
      "turn_loss": 0.25044867396354675,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.24107972495818622,
      "grad_norm": 0.7114866971969604,
      "learning_rate": 6.142784152715867e-06,
      "loss": 0.1495,
      "mae_dtheta": 0.052003055810928345,
      "mae_dx": 0.010391722433269024,
      "mae_dy": 0.0040650092996656895,
      "pose_mae_dtheta": 0.4337601363658905,
      "pose_mae_dx": 0.06166853755712509,
      "pose_mae_dy": 0.04145161435008049,
      "pose_rmse_dtheta": 0.7008670568466187,
      "pose_rmse_dx": 0.140742227435112,
      "pose_rmse_dy": 0.11313082277774811,
      "pose_rmse_mean": 0.3182467222213745,
      "rmse_dtheta": 0.07270004600286484,
      "rmse_dx": 0.02099924348294735,
      "rmse_dy": 0.008871763944625854,
      "rmse_mean": 0.034190353006124496,
      "rotation_flip": 0.017208412289619446,
      "sparse_tokens": 8107.0,
      "step": 5189,
      "turn_loss": 0.3598712384700775,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.241126184724029,
      "grad_norm": 0.6284361481666565,
      "learning_rate": 6.141496892026483e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.03733221814036369,
      "mae_dx": 0.012794296257197857,
      "mae_dy": 0.0050663393922150135,
      "pose_mae_dtheta": 0.3071867525577545,
      "pose_mae_dx": 0.08675406873226166,
      "pose_mae_dy": 0.06739336252212524,
      "pose_rmse_dtheta": 0.5621647834777832,
      "pose_rmse_dx": 0.19146576523780823,
      "pose_rmse_dy": 0.16074514389038086,
      "pose_rmse_mean": 0.3047918975353241,
      "rmse_dtheta": 0.057353194802999496,
      "rmse_dx": 0.025032825767993927,
      "rmse_dy": 0.00901071447879076,
      "rmse_mean": 0.03046557866036892,
      "rotation_flip": 0.005692599806934595,
      "sparse_tokens": 9761.0,
      "step": 5190,
      "turn_loss": 0.21708950400352478,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.24117264448987177,
      "grad_norm": 0.7161843180656433,
      "learning_rate": 6.140209551511609e-06,
      "loss": 0.1452,
      "mae_dtheta": 0.03488878533244133,
      "mae_dx": 0.00831715576350689,
      "mae_dy": 0.005470870994031429,
      "pose_mae_dtheta": 0.24811618030071259,
      "pose_mae_dx": 0.07386109232902527,
      "pose_mae_dy": 0.06945869326591492,
      "pose_rmse_dtheta": 0.44023823738098145,
      "pose_rmse_dx": 0.18260475993156433,
      "pose_rmse_dy": 0.14328667521476746,
      "pose_rmse_mean": 0.25537657737731934,
      "rmse_dtheta": 0.053717177361249924,
      "rmse_dx": 0.020115770399570465,
      "rmse_dy": 0.009429198689758778,
      "rmse_mean": 0.027754049748182297,
      "rotation_flip": 0.01306240912526846,
      "sparse_tokens": 11915.0,
      "step": 5191,
      "turn_loss": 0.22836196422576904,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.24121910425571455,
      "grad_norm": 0.6451438069343567,
      "learning_rate": 6.138922131261268e-06,
      "loss": 0.2067,
      "mae_dtheta": 0.032655198127031326,
      "mae_dx": 0.009484254755079746,
      "mae_dy": 0.006701101083308458,
      "pose_mae_dtheta": 0.25439104437828064,
      "pose_mae_dx": 0.07954946905374527,
      "pose_mae_dy": 0.0713639184832573,
      "pose_rmse_dtheta": 0.48004424571990967,
      "pose_rmse_dx": 0.17616955935955048,
      "pose_rmse_dy": 0.1496128886938095,
      "pose_rmse_mean": 0.2686089277267456,
      "rmse_dtheta": 0.05173029750585556,
      "rmse_dx": 0.0201030895113945,
      "rmse_dy": 0.012692660093307495,
      "rmse_mean": 0.02817535027861595,
      "rotation_flip": 0.016895459964871407,
      "sparse_tokens": 15557.0,
      "step": 5192,
      "turn_loss": 0.264250248670578,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.24126556402155733,
      "grad_norm": 0.46490511298179626,
      "learning_rate": 6.137634631365491e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.009887470863759518,
      "mae_dx": 0.001776549848727882,
      "mae_dy": 0.00044891409925185144,
      "pose_mae_dtheta": 0.07663874328136444,
      "pose_mae_dx": 0.01398134883493185,
      "pose_mae_dy": 0.005506902001798153,
      "pose_rmse_dtheta": 0.29190686345100403,
      "pose_rmse_dx": 0.032711051404476166,
      "pose_rmse_dy": 0.020131878554821014,
      "pose_rmse_mean": 0.1149166077375412,
      "rmse_dtheta": 0.032407164573669434,
      "rmse_dx": 0.005118904635310173,
      "rmse_dy": 0.0013596978969871998,
      "rmse_mean": 0.012961923144757748,
      "rotation_flip": 0.0011376563925296068,
      "sparse_tokens": 32233.0,
      "step": 5193,
      "turn_loss": 0.054601967334747314,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2413120237874001,
      "grad_norm": 0.43317416310310364,
      "learning_rate": 6.136347051914315e-06,
      "loss": 0.0673,
      "mae_dtheta": 0.010111489333212376,
      "mae_dx": 0.0014564420562237501,
      "mae_dy": 0.00234377384185791,
      "pose_mae_dtheta": 0.07907670736312866,
      "pose_mae_dx": 0.022834017872810364,
      "pose_mae_dy": 0.03570949658751488,
      "pose_rmse_dtheta": 0.19531254470348358,
      "pose_rmse_dx": 0.056914810091257095,
      "pose_rmse_dy": 0.09953209012746811,
      "pose_rmse_mean": 0.11725315451622009,
      "rmse_dtheta": 0.02199302427470684,
      "rmse_dx": 0.004465059377253056,
      "rmse_dy": 0.005144990514963865,
      "rmse_mean": 0.010534359142184258,
      "rotation_flip": 0.006524575874209404,
      "sparse_tokens": 32073.0,
      "step": 5194,
      "turn_loss": 0.07749343663454056,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.24135848355324288,
      "grad_norm": 0.41078922152519226,
      "learning_rate": 6.135059392997779e-06,
      "loss": 0.1,
      "mae_dtheta": 0.007937905378639698,
      "mae_dx": 0.0016747390618547797,
      "mae_dy": 0.0002552361402194947,
      "pose_mae_dtheta": 0.05492037907242775,
      "pose_mae_dx": 0.013995706103742123,
      "pose_mae_dy": 0.002926208544522524,
      "pose_rmse_dtheta": 0.23845502734184265,
      "pose_rmse_dx": 0.031839825212955475,
      "pose_rmse_dy": 0.005823457147926092,
      "pose_rmse_mean": 0.09203943610191345,
      "rmse_dtheta": 0.02942325361073017,
      "rmse_dx": 0.004566254559904337,
      "rmse_dy": 0.0005383276147767901,
      "rmse_mean": 0.011509278789162636,
      "rotation_flip": 0.0017371163703501225,
      "sparse_tokens": 32233.0,
      "step": 5195,
      "turn_loss": 0.04578345641493797,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.24140494331908569,
      "grad_norm": 0.46624812483787537,
      "learning_rate": 6.133771654705932e-06,
      "loss": 0.1094,
      "mae_dtheta": 0.02954375371336937,
      "mae_dx": 0.015922820195555687,
      "mae_dy": 0.015184169635176659,
      "pose_mae_dtheta": 0.24496527016162872,
      "pose_mae_dx": 0.10015201568603516,
      "pose_mae_dy": 0.16760750114917755,
      "pose_rmse_dtheta": 0.35696011781692505,
      "pose_rmse_dx": 0.20498226583003998,
      "pose_rmse_dy": 0.2997629940509796,
      "pose_rmse_mean": 0.2872351408004761,
      "rmse_dtheta": 0.041135888546705246,
      "rmse_dx": 0.0287970881909132,
      "rmse_dy": 0.022302813827991486,
      "rmse_mean": 0.030745264142751694,
      "rotation_flip": 0.01937984488904476,
      "sparse_tokens": 4061.0,
      "step": 5196,
      "turn_loss": 0.29932862520217896,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.24145140308492846,
      "grad_norm": 0.4143860340118408,
      "learning_rate": 6.132483837128823e-06,
      "loss": 0.1093,
      "mae_dtheta": 0.010525007732212543,
      "mae_dx": 0.003202872583642602,
      "mae_dy": 0.0017169585917145014,
      "pose_mae_dtheta": 0.07015697658061981,
      "pose_mae_dx": 0.033998243510723114,
      "pose_mae_dy": 0.020289113745093346,
      "pose_rmse_dtheta": 0.18691429495811462,
      "pose_rmse_dx": 0.08973226696252823,
      "pose_rmse_dy": 0.05082651227712631,
      "pose_rmse_mean": 0.10915769636631012,
      "rmse_dtheta": 0.024394452571868896,
      "rmse_dx": 0.009552206844091415,
      "rmse_dy": 0.003853048663586378,
      "rmse_mean": 0.012599903158843517,
      "rotation_flip": 0.004934948403388262,
      "sparse_tokens": 32105.0,
      "step": 5197,
      "turn_loss": 0.126314178109169,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24149786285077124,
      "grad_norm": 0.5344837307929993,
      "learning_rate": 6.131195940356511e-06,
      "loss": 0.1378,
      "mae_dtheta": 0.0076795583590865135,
      "mae_dx": 0.002348701236769557,
      "mae_dy": 0.002085519954562187,
      "pose_mae_dtheta": 0.060778480023145676,
      "pose_mae_dx": 0.02116084285080433,
      "pose_mae_dy": 0.017571527510881424,
      "pose_rmse_dtheta": 0.1849018931388855,
      "pose_rmse_dx": 0.058304011821746826,
      "pose_rmse_dy": 0.0563613660633564,
      "pose_rmse_mean": 0.09985576570034027,
      "rmse_dtheta": 0.022164367139339447,
      "rmse_dx": 0.008157514967024326,
      "rmse_dy": 0.007617462892085314,
      "rmse_mean": 0.012646447867155075,
      "rotation_flip": 0.001612903201021254,
      "sparse_tokens": 32121.0,
      "step": 5198,
      "turn_loss": 0.07155374437570572,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.24154432261661402,
      "grad_norm": 0.4363287091255188,
      "learning_rate": 6.129907964479061e-06,
      "loss": 0.1101,
      "mae_dtheta": 0.010433973744511604,
      "mae_dx": 0.0017118804389610887,
      "mae_dy": 0.002359342761337757,
      "pose_mae_dtheta": 0.0715290904045105,
      "pose_mae_dx": 0.02459668181836605,
      "pose_mae_dy": 0.030152875930070877,
      "pose_rmse_dtheta": 0.1805773824453354,
      "pose_rmse_dx": 0.06984365731477737,
      "pose_rmse_dy": 0.06981903314590454,
      "pose_rmse_mean": 0.10674669593572617,
      "rmse_dtheta": 0.021487437188625336,
      "rmse_dx": 0.005182182416319847,
      "rmse_dy": 0.005341551266610622,
      "rmse_mean": 0.010670389980077744,
      "rotation_flip": 0.00408663647249341,
      "sparse_tokens": 32057.0,
      "step": 5199,
      "turn_loss": 0.0768618956208229,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10408.0,
      "epoch": 0.2415907823824568,
      "grad_norm": 1.2268314361572266,
      "learning_rate": 6.128619909586539e-06,
      "loss": 0.2864,
      "mae_dtheta": 0.028913632035255432,
      "mae_dx": 0.01186924148350954,
      "mae_dy": 0.0054352860897779465,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999992251396179,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.22787475585938,
      "model/head/act_norm_mean": 113.86093139648438,
      "model/head/act_norm_min": 74.50931549072266,
      "model/head/act_over_embed": 78.24629803849864,
      "model/head/grad_frac": 0.08418852835893631,
      "model/head/grad_norm": 0.08418846130371094,
      "model/head/grad_zero_frac": 0.00015229044947773218,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.686492919921875,
      "model/head/update_ratio": 0.001441202242858708,
      "model/head/weight_delta": 8.434037208557129,
      "model/head/weight_delta_rel": 0.14795799553394318,
      "model/head/weight_norm": 58.41543960571289,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4201917052268982,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42015720136237866,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4201209545135498,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2887359623499202,
      "model/modality_embedder.encoders.pose/grad_frac": 0.13359352946281433,
      "model/modality_embedder.encoders.pose/grad_norm": 0.13359342515468597,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5423768939393939,
      "model/modality_embedder.encoders.pose/update_ratio": 0.004320717416703701,
      "model/modality_embedder.encoders.pose/weight_delta": 2.756178140640259,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09005293250083923,
      "model/modality_embedder.encoders.pose/weight_norm": 30.919269561767578,
      "model/modality_embedder/grad_frac": 0.13359352946281433,
      "model/modality_embedder/grad_norm": 0.13359342515468597,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5423768939393939,
      "model/modality_embedder/update_ratio": 0.004320717416703701,
      "model/modality_embedder/weight_delta": 2.756178140640259,
      "model/modality_embedder/weight_delta_rel": 0.09005293250083923,
      "model/modality_embedder/weight_norm": 30.919269561767578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.3258056640625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.987657335069443,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.118459701538086,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.484542696645946,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06850717961788177,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0685071274638176,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0024624981451779604,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.089416265487671,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07613959163427353,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.820175170898438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.0508041381836,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.85424610925099,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.522686958312988,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.08007061539543,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07032118737697601,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07032113522291183,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0023805848322808743,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.6485483646392822,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09174778312444687,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.539438247680664,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.68521118164062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.503780304439484,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.5878324508667,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.21364595751141,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06349323689937592,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06349318474531174,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002082059858366847,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.8503572940826416,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0957096591591835,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.49536895751953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.22317504882812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.39232429625496,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.791221618652344,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.511471069514425,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05497445911169052,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05497441813349724,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018464821623638272,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.4348344802856445,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08321108669042587,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.77251434326172,
      "model/normalizer/grad_frac": 0.24089199304580688,
      "model/normalizer/grad_norm": 0.24089179933071136,
      "model/normalizer/grad_zero_frac": 0.00021034943347331136,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003072660183534026,
      "model/normalizer/weight_delta": 5.160775661468506,
      "model/normalizer/weight_delta_rel": 0.06646779924631119,
      "model/normalizer/weight_norm": 78.39845275878906,
      "pose_mae_dtheta": 0.22409687936306,
      "pose_mae_dx": 0.08991765975952148,
      "pose_mae_dy": 0.05024297162890434,
      "pose_rmse_dtheta": 0.45403194427490234,
      "pose_rmse_dx": 0.18753185868263245,
      "pose_rmse_dy": 0.1157001256942749,
      "pose_rmse_mean": 0.2524213194847107,
      "rmse_dtheta": 0.04747818782925606,
      "rmse_dx": 0.023610472679138184,
      "rmse_dy": 0.009919109754264355,
      "rmse_mean": 0.027002587914466858,
      "rotation_flip": 0.015418502502143383,
      "sparse_tokens": 8636.0,
      "step": 5200,
      "turn_loss": 0.22952640056610107,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "epoch": 0.2415907823824568,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.312545508146286,
      "eval_objectnav_nopose_mae_dtheta": 0.0413646325469017,
      "eval_objectnav_nopose_mae_dx": 0.013741742819547653,
      "eval_objectnav_nopose_mae_dy": 0.004876342602074146,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3338984251022339,
      "eval_objectnav_nopose_pose_mae_dx": 0.11184711009263992,
      "eval_objectnav_nopose_pose_mae_dy": 0.057044513523578644,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5624332427978516,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2419130802154541,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1328338086605072,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3123933970928192,
      "eval_objectnav_nopose_rmse_dtheta": 0.059610892087221146,
      "eval_objectnav_nopose_rmse_dx": 0.026569366455078125,
      "eval_objectnav_nopose_rmse_dy": 0.009933213703334332,
      "eval_objectnav_nopose_rmse_mean": 0.032037824392318726,
      "eval_objectnav_nopose_rotation_flip": 0.01445367094129324,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.312545508146286,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 5200
    },
    {
      "epoch": 0.2415907823824568,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28128349781036377,
      "eval_objectnav_pose_mae_dtheta": 0.036971837282180786,
      "eval_objectnav_pose_mae_dx": 0.012015913613140583,
      "eval_objectnav_pose_mae_dy": 0.004655512981116772,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2817420959472656,
      "eval_objectnav_pose_pose_mae_dx": 0.09427960962057114,
      "eval_objectnav_pose_pose_mae_dy": 0.05107726901769638,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4925527274608612,
      "eval_objectnav_pose_pose_rmse_dx": 0.21509085595607758,
      "eval_objectnav_pose_pose_rmse_dy": 0.12298928201198578,
      "eval_objectnav_pose_pose_rmse_mean": 0.27687764167785645,
      "eval_objectnav_pose_rmse_dtheta": 0.05484882369637489,
      "eval_objectnav_pose_rmse_dx": 0.024503985419869423,
      "eval_objectnav_pose_rmse_dy": 0.009805838577449322,
      "eval_objectnav_pose_rmse_mean": 0.029719550162553787,
      "eval_objectnav_pose_rotation_flip": 0.01625327579677105,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28128349781036377,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 5200
    },
    {
      "epoch": 0.2415907823824568,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09568943083286285,
      "eval_pointnav_mae_dtheta": 0.010792871937155724,
      "eval_pointnav_mae_dx": 0.0025937093887478113,
      "eval_pointnav_mae_dy": 0.0024962492752820253,
      "eval_pointnav_pose_mae_dtheta": 0.07462769746780396,
      "eval_pointnav_pose_mae_dx": 0.028316736221313477,
      "eval_pointnav_pose_mae_dy": 0.027442259714007378,
      "eval_pointnav_pose_rmse_dtheta": 0.20607908070087433,
      "eval_pointnav_pose_rmse_dx": 0.08417744189500809,
      "eval_pointnav_pose_rmse_dy": 0.07879096269607544,
      "eval_pointnav_pose_rmse_mean": 0.12301583588123322,
      "eval_pointnav_rmse_dtheta": 0.025880437344312668,
      "eval_pointnav_rmse_dx": 0.008086456917226315,
      "eval_pointnav_rmse_dy": 0.006648150272667408,
      "eval_pointnav_rmse_mean": 0.013538348488509655,
      "eval_pointnav_rotation_flip": 0.0061035118997097015,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09568943083286285,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 5200
    },
    {
      "epoch": 0.2415907823824568,
      "eval_loss": 0.22983947892983755,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.312545508146286,
      "eval_objectnav_nopose_mae_dtheta": 0.0413646325469017,
      "eval_objectnav_nopose_mae_dx": 0.013741742819547653,
      "eval_objectnav_nopose_mae_dy": 0.004876342602074146,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3338984251022339,
      "eval_objectnav_nopose_pose_mae_dx": 0.11184711009263992,
      "eval_objectnav_nopose_pose_mae_dy": 0.057044513523578644,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5624332427978516,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2419130802154541,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1328338086605072,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3123933970928192,
      "eval_objectnav_nopose_rmse_dtheta": 0.059610892087221146,
      "eval_objectnav_nopose_rmse_dx": 0.026569366455078125,
      "eval_objectnav_nopose_rmse_dy": 0.009933213703334332,
      "eval_objectnav_nopose_rmse_mean": 0.032037824392318726,
      "eval_objectnav_nopose_rotation_flip": 0.01445367094129324,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.312545508146286,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28128349781036377,
      "eval_objectnav_pose_mae_dtheta": 0.036971837282180786,
      "eval_objectnav_pose_mae_dx": 0.012015913613140583,
      "eval_objectnav_pose_mae_dy": 0.004655512981116772,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2817420959472656,
      "eval_objectnav_pose_pose_mae_dx": 0.09427960962057114,
      "eval_objectnav_pose_pose_mae_dy": 0.05107726901769638,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4925527274608612,
      "eval_objectnav_pose_pose_rmse_dx": 0.21509085595607758,
      "eval_objectnav_pose_pose_rmse_dy": 0.12298928201198578,
      "eval_objectnav_pose_pose_rmse_mean": 0.27687764167785645,
      "eval_objectnav_pose_rmse_dtheta": 0.05484882369637489,
      "eval_objectnav_pose_rmse_dx": 0.024503985419869423,
      "eval_objectnav_pose_rmse_dy": 0.009805838577449322,
      "eval_objectnav_pose_rmse_mean": 0.029719550162553787,
      "eval_objectnav_pose_rotation_flip": 0.01625327579677105,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28128349781036377,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09568943083286285,
      "eval_pointnav_mae_dtheta": 0.010792871937155724,
      "eval_pointnav_mae_dx": 0.0025937093887478113,
      "eval_pointnav_mae_dy": 0.0024962492752820253,
      "eval_pointnav_pose_mae_dtheta": 0.07462769746780396,
      "eval_pointnav_pose_mae_dx": 0.028316736221313477,
      "eval_pointnav_pose_mae_dy": 0.027442259714007378,
      "eval_pointnav_pose_rmse_dtheta": 0.20607908070087433,
      "eval_pointnav_pose_rmse_dx": 0.08417744189500809,
      "eval_pointnav_pose_rmse_dy": 0.07879096269607544,
      "eval_pointnav_pose_rmse_mean": 0.12301583588123322,
      "eval_pointnav_rmse_dtheta": 0.025880437344312668,
      "eval_pointnav_rmse_dx": 0.008086456917226315,
      "eval_pointnav_rmse_dy": 0.006648150272667408,
      "eval_pointnav_rmse_mean": 0.013538348488509655,
      "eval_pointnav_rotation_flip": 0.0061035118997097015,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09568943083286285,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 5200
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.24163724214829957,
      "grad_norm": 0.5511487722396851,
      "learning_rate": 6.127331775769023e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.012427336536347866,
      "mae_dx": 0.001607078011147678,
      "mae_dy": 0.003073832020163536,
      "pose_mae_dtheta": 0.08413983881473541,
      "pose_mae_dx": 0.022854210808873177,
      "pose_mae_dy": 0.03623895347118378,
      "pose_rmse_dtheta": 0.2036106139421463,
      "pose_rmse_dx": 0.05399606004357338,
      "pose_rmse_dy": 0.08739569038152695,
      "pose_rmse_mean": 0.11500079929828644,
      "rmse_dtheta": 0.024894552305340767,
      "rmse_dx": 0.004731580149382353,
      "rmse_dy": 0.006781919859349728,
      "rmse_mean": 0.01213601790368557,
      "rotation_flip": 0.00632466608658433,
      "sparse_tokens": 32089.0,
      "step": 5201,
      "turn_loss": 0.08511102944612503,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24168370191414235,
      "grad_norm": 0.3436836302280426,
      "learning_rate": 6.126043563116591e-06,
      "loss": 0.0827,
      "mae_dtheta": 0.009216982871294022,
      "mae_dx": 0.0019741738215088844,
      "mae_dy": 0.002693258924409747,
      "pose_mae_dtheta": 0.06630446761846542,
      "pose_mae_dx": 0.021820437163114548,
      "pose_mae_dy": 0.02840685099363327,
      "pose_rmse_dtheta": 0.16625645756721497,
      "pose_rmse_dx": 0.07719534635543823,
      "pose_rmse_dy": 0.06479348242282867,
      "pose_rmse_mean": 0.10274843871593475,
      "rmse_dtheta": 0.020997781306505203,
      "rmse_dx": 0.006725552026182413,
      "rmse_dy": 0.007157330866903067,
      "rmse_mean": 0.011626888066530228,
      "rotation_flip": 0.005056890193372965,
      "sparse_tokens": 32073.0,
      "step": 5202,
      "turn_loss": 0.0771319717168808,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36875.0,
      "epoch": 0.24173016167998512,
      "grad_norm": 0.4232538342475891,
      "learning_rate": 6.124755271719326e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.03682340681552887,
      "mae_dx": 0.015733886510133743,
      "mae_dy": 0.005064820405095816,
      "pose_mae_dtheta": 0.29938000440597534,
      "pose_mae_dx": 0.12195546925067902,
      "pose_mae_dy": 0.07543304562568665,
      "pose_rmse_dtheta": 0.5226244926452637,
      "pose_rmse_dx": 0.25067245960235596,
      "pose_rmse_dy": 0.1577203869819641,
      "pose_rmse_mean": 0.3103391230106354,
      "rmse_dtheta": 0.05449962243437767,
      "rmse_dx": 0.02858543209731579,
      "rmse_dy": 0.009698049165308475,
      "rmse_mean": 0.03092770092189312,
      "rotation_flip": 0.013731343671679497,
      "sparse_tokens": 27747.0,
      "step": 5203,
      "turn_loss": 0.24641066789627075,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2417766214458279,
      "grad_norm": 0.5276367664337158,
      "learning_rate": 6.123466901667321e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.010411281138658524,
      "mae_dx": 0.002068932866677642,
      "mae_dy": 0.0021604050416499376,
      "pose_mae_dtheta": 0.06835166364908218,
      "pose_mae_dx": 0.021172353997826576,
      "pose_mae_dy": 0.02421598508954048,
      "pose_rmse_dtheta": 0.18139061331748962,
      "pose_rmse_dx": 0.04831370338797569,
      "pose_rmse_dy": 0.05975637212395668,
      "pose_rmse_mean": 0.096486896276474,
      "rmse_dtheta": 0.024883370846509933,
      "rmse_dx": 0.006122929975390434,
      "rmse_dy": 0.0051155295222997665,
      "rmse_mean": 0.012040610425174236,
      "rotation_flip": 0.004885993432253599,
      "sparse_tokens": 32121.0,
      "step": 5204,
      "turn_loss": 0.08466329425573349,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2418230812116707,
      "grad_norm": 0.4965754747390747,
      "learning_rate": 6.122178453050675e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.007454597856849432,
      "mae_dx": 0.0017330491682514548,
      "mae_dy": 0.0015507859643548727,
      "pose_mae_dtheta": 0.05170462653040886,
      "pose_mae_dx": 0.016163397580385208,
      "pose_mae_dy": 0.017380116507411003,
      "pose_rmse_dtheta": 0.17559336125850677,
      "pose_rmse_dx": 0.04481206089258194,
      "pose_rmse_dy": 0.04401283711194992,
      "pose_rmse_mean": 0.08813942968845367,
      "rmse_dtheta": 0.0218841340392828,
      "rmse_dx": 0.005369024816900492,
      "rmse_dy": 0.004124350845813751,
      "rmse_mean": 0.010459169745445251,
      "rotation_flip": 0.004675628151744604,
      "sparse_tokens": 32105.0,
      "step": 5205,
      "turn_loss": 0.07007193565368652,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.24186954097751348,
      "grad_norm": 0.5829562544822693,
      "learning_rate": 6.120889925959486e-06,
      "loss": 0.1525,
      "mae_dtheta": 0.0357479564845562,
      "mae_dx": 0.013056900352239609,
      "mae_dy": 0.004834743682295084,
      "pose_mae_dtheta": 0.28381285071372986,
      "pose_mae_dx": 0.10997362434864044,
      "pose_mae_dy": 0.050372447818517685,
      "pose_rmse_dtheta": 0.5100687742233276,
      "pose_rmse_dx": 0.22494377195835114,
      "pose_rmse_dy": 0.12966591119766235,
      "pose_rmse_mean": 0.2882261574268341,
      "rmse_dtheta": 0.05466996133327484,
      "rmse_dx": 0.02518545836210251,
      "rmse_dy": 0.010484108701348305,
      "rmse_mean": 0.03011317551136017,
      "rotation_flip": 0.009532062336802483,
      "sparse_tokens": 19235.0,
      "step": 5206,
      "turn_loss": 0.27934661507606506,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.24191600074335626,
      "grad_norm": 0.7887707948684692,
      "learning_rate": 6.119601320483864e-06,
      "loss": 0.1453,
      "mae_dtheta": 0.009009644389152527,
      "mae_dx": 0.0013035262236371636,
      "mae_dy": 0.0011380489449948072,
      "pose_mae_dtheta": 0.06294083595275879,
      "pose_mae_dx": 0.013929548673331738,
      "pose_mae_dy": 0.01497364416718483,
      "pose_rmse_dtheta": 0.19850483536720276,
      "pose_rmse_dx": 0.031233010813593864,
      "pose_rmse_dy": 0.033544063568115234,
      "pose_rmse_mean": 0.08776064217090607,
      "rmse_dtheta": 0.024958470836281776,
      "rmse_dx": 0.0037051448598504066,
      "rmse_dy": 0.0023052007891237736,
      "rmse_mean": 0.010322939604520798,
      "rotation_flip": 0.0015366884181275964,
      "sparse_tokens": 32201.0,
      "step": 5207,
      "turn_loss": 0.06391187012195587,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.24196246050919903,
      "grad_norm": 0.32834649085998535,
      "learning_rate": 6.118312636713919e-06,
      "loss": 0.0644,
      "mae_dtheta": 0.006346608977764845,
      "mae_dx": 0.0009564333595335484,
      "mae_dy": 0.0012125781504437327,
      "pose_mae_dtheta": 0.04025609791278839,
      "pose_mae_dx": 0.010718004778027534,
      "pose_mae_dy": 0.017573202028870583,
      "pose_rmse_dtheta": 0.12340796738862991,
      "pose_rmse_dx": 0.03405006229877472,
      "pose_rmse_dy": 0.04723251238465309,
      "pose_rmse_mean": 0.06823018193244934,
      "rmse_dtheta": 0.018150998279452324,
      "rmse_dx": 0.0036662803031504154,
      "rmse_dy": 0.0031985929235816,
      "rmse_mean": 0.008338624611496925,
      "rotation_flip": 0.004433185327798128,
      "sparse_tokens": 32041.0,
      "step": 5208,
      "turn_loss": 0.052160587161779404,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.2420089202750418,
      "grad_norm": 0.48123666644096375,
      "learning_rate": 6.1170238747397715e-06,
      "loss": 0.091,
      "mae_dtheta": 0.024607660248875618,
      "mae_dx": 0.010521183721721172,
      "mae_dy": 0.0018346254946663976,
      "pose_mae_dtheta": 0.16977857053279877,
      "pose_mae_dx": 0.08072637766599655,
      "pose_mae_dy": 0.024584278464317322,
      "pose_rmse_dtheta": 0.3411285877227783,
      "pose_rmse_dx": 0.18592743575572968,
      "pose_rmse_dy": 0.06965645402669907,
      "pose_rmse_mean": 0.1989041566848755,
      "rmse_dtheta": 0.04285046458244324,
      "rmse_dx": 0.022468866780400276,
      "rmse_dy": 0.003983345814049244,
      "rmse_mean": 0.023100893944501877,
      "rotation_flip": 0.006369426846504211,
      "sparse_tokens": 6326.0,
      "step": 5209,
      "turn_loss": 0.13014079630374908,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.2420553800408846,
      "grad_norm": 0.483010858297348,
      "learning_rate": 6.115735034651547e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.03186770901083946,
      "mae_dx": 0.009835278615355492,
      "mae_dy": 0.008406853303313255,
      "pose_mae_dtheta": 0.2073603719472885,
      "pose_mae_dx": 0.07470567524433136,
      "pose_mae_dy": 0.049659550189971924,
      "pose_rmse_dtheta": 0.3659486472606659,
      "pose_rmse_dx": 0.17497645318508148,
      "pose_rmse_dy": 0.12604674696922302,
      "pose_rmse_mean": 0.222323939204216,
      "rmse_dtheta": 0.04828275740146637,
      "rmse_dx": 0.02061721868813038,
      "rmse_dy": 0.017520617693662643,
      "rmse_mean": 0.028806865215301514,
      "rotation_flip": 0.016187049448490143,
      "sparse_tokens": 8957.0,
      "step": 5210,
      "turn_loss": 0.2668582499027252,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24210183980672736,
      "grad_norm": 0.7353489398956299,
      "learning_rate": 6.114446116539369e-06,
      "loss": 0.1586,
      "mae_dtheta": 0.009639313444495201,
      "mae_dx": 0.001581552904099226,
      "mae_dy": 0.0025547395925968885,
      "pose_mae_dtheta": 0.06556524336338043,
      "pose_mae_dx": 0.021208640187978745,
      "pose_mae_dy": 0.027737734839320183,
      "pose_rmse_dtheta": 0.1364324390888214,
      "pose_rmse_dx": 0.05373263731598854,
      "pose_rmse_dy": 0.05777798593044281,
      "pose_rmse_mean": 0.08264768868684769,
      "rmse_dtheta": 0.018705084919929504,
      "rmse_dx": 0.004458459559828043,
      "rmse_dy": 0.005843592807650566,
      "rmse_mean": 0.0096690459176898,
      "rotation_flip": 0.002259522210806608,
      "sparse_tokens": 32121.0,
      "step": 5211,
      "turn_loss": 0.07611814141273499,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11379.0,
      "epoch": 0.24214829957257014,
      "grad_norm": 0.5757546424865723,
      "learning_rate": 6.1131571204933786e-06,
      "loss": 0.1729,
      "mae_dtheta": 0.02273210510611534,
      "mae_dx": 0.010105840861797333,
      "mae_dy": 0.004748307168483734,
      "pose_mae_dtheta": 0.17460648715496063,
      "pose_mae_dx": 0.07811257243156433,
      "pose_mae_dy": 0.07888142019510269,
      "pose_rmse_dtheta": 0.2970220744609833,
      "pose_rmse_dx": 0.21301577985286713,
      "pose_rmse_dy": 0.1699995994567871,
      "pose_rmse_mean": 0.22667914628982544,
      "rmse_dtheta": 0.03583456203341484,
      "rmse_dx": 0.023594394326210022,
      "rmse_dy": 0.008385410532355309,
      "rmse_mean": 0.022604789584875107,
      "rotation_flip": 0.015350877307355404,
      "sparse_tokens": 9657.0,
      "step": 5212,
      "turn_loss": 0.16988646984100342,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24219475933841295,
      "grad_norm": 0.37498578429222107,
      "learning_rate": 6.111868046603712e-06,
      "loss": 0.0622,
      "mae_dtheta": 0.006605576723814011,
      "mae_dx": 0.0007976273773238063,
      "mae_dy": 0.0009560998878441751,
      "pose_mae_dtheta": 0.04848482832312584,
      "pose_mae_dx": 0.00889673549681902,
      "pose_mae_dy": 0.016536390408873558,
      "pose_rmse_dtheta": 0.17584244906902313,
      "pose_rmse_dx": 0.022797467187047005,
      "pose_rmse_dy": 0.04610205814242363,
      "pose_rmse_mean": 0.08158066123723984,
      "rmse_dtheta": 0.020317820832133293,
      "rmse_dx": 0.0024453105870634317,
      "rmse_dy": 0.002175728790462017,
      "rmse_mean": 0.008312953636050224,
      "rotation_flip": 0.0,
      "sparse_tokens": 32073.0,
      "step": 5213,
      "turn_loss": 0.04105943441390991,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.24224121910425572,
      "grad_norm": 0.4372413456439972,
      "learning_rate": 6.110578894960517e-06,
      "loss": 0.101,
      "mae_dtheta": 0.012318521738052368,
      "mae_dx": 0.003102167509496212,
      "mae_dy": 0.0049354312941432,
      "pose_mae_dtheta": 0.09319242089986801,
      "pose_mae_dx": 0.03287115693092346,
      "pose_mae_dy": 0.045715250074863434,
      "pose_rmse_dtheta": 0.24363675713539124,
      "pose_rmse_dx": 0.08051323145627975,
      "pose_rmse_dy": 0.1451120674610138,
      "pose_rmse_mean": 0.15642069280147552,
      "rmse_dtheta": 0.02754676342010498,
      "rmse_dx": 0.008161376230418682,
      "rmse_dy": 0.014372044242918491,
      "rmse_mean": 0.016693394631147385,
      "rotation_flip": 0.002927645342424512,
      "sparse_tokens": 32089.0,
      "step": 5214,
      "turn_loss": 0.1168585866689682,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2422876788700985,
      "grad_norm": 0.42800477147102356,
      "learning_rate": 6.109289665653944e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.010049554519355297,
      "mae_dx": 0.0017365141538903117,
      "mae_dy": 0.002902796259149909,
      "pose_mae_dtheta": 0.0662788599729538,
      "pose_mae_dx": 0.025243351235985756,
      "pose_mae_dy": 0.03070463240146637,
      "pose_rmse_dtheta": 0.14231617748737335,
      "pose_rmse_dx": 0.06440478563308716,
      "pose_rmse_dy": 0.07204142957925797,
      "pose_rmse_mean": 0.09292080253362656,
      "rmse_dtheta": 0.02034037932753563,
      "rmse_dx": 0.005219347309321165,
      "rmse_dy": 0.006289020646363497,
      "rmse_mean": 0.010616249404847622,
      "rotation_flip": 0.005407493095844984,
      "sparse_tokens": 32057.0,
      "step": 5215,
      "turn_loss": 0.0826428234577179,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24233413863594128,
      "grad_norm": 0.43491506576538086,
      "learning_rate": 6.10800035877415e-06,
      "loss": 0.0843,
      "mae_dtheta": 0.004661533981561661,
      "mae_dx": 0.0012392931384965777,
      "mae_dy": 0.00023161132412496954,
      "pose_mae_dtheta": 0.03632698580622673,
      "pose_mae_dx": 0.009900005534291267,
      "pose_mae_dy": 0.003945556934922934,
      "pose_rmse_dtheta": 0.17098116874694824,
      "pose_rmse_dx": 0.030690204352140427,
      "pose_rmse_dy": 0.00716834282502532,
      "pose_rmse_mean": 0.06961324065923691,
      "rmse_dtheta": 0.020854327827692032,
      "rmse_dx": 0.0040993825532495975,
      "rmse_dy": 0.0004705929313786328,
      "rmse_mean": 0.00847476813942194,
      "rotation_flip": 0.0030487803742289543,
      "sparse_tokens": 32121.0,
      "step": 5216,
      "turn_loss": 0.03806471452116966,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.24238059840178405,
      "grad_norm": 0.30903029441833496,
      "learning_rate": 6.106710974411294e-06,
      "loss": 0.0809,
      "mae_dtheta": 0.012848596088588238,
      "mae_dx": 0.003312645945698023,
      "mae_dy": 0.003974155522882938,
      "pose_mae_dtheta": 0.09056970477104187,
      "pose_mae_dx": 0.03669770807027817,
      "pose_mae_dy": 0.033398933708667755,
      "pose_rmse_dtheta": 0.23901474475860596,
      "pose_rmse_dx": 0.10977756232023239,
      "pose_rmse_dy": 0.0763384997844696,
      "pose_rmse_mean": 0.1417102813720703,
      "rmse_dtheta": 0.027611425146460533,
      "rmse_dx": 0.011047006584703922,
      "rmse_dy": 0.009789359755814075,
      "rmse_mean": 0.016149263828992844,
      "rotation_flip": 0.004687500186264515,
      "sparse_tokens": 32089.0,
      "step": 5217,
      "turn_loss": 0.12609155476093292,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.24242705816762683,
      "grad_norm": 0.5525169968605042,
      "learning_rate": 6.105421512655546e-06,
      "loss": 0.12,
      "mae_dtheta": 0.031180227175354958,
      "mae_dx": 0.019516710191965103,
      "mae_dy": 0.004576127044856548,
      "pose_mae_dtheta": 0.253356397151947,
      "pose_mae_dx": 0.14143973588943481,
      "pose_mae_dy": 0.05568017065525055,
      "pose_rmse_dtheta": 0.46225354075431824,
      "pose_rmse_dx": 0.28559938073158264,
      "pose_rmse_dy": 0.1257324367761612,
      "pose_rmse_mean": 0.2911951243877411,
      "rmse_dtheta": 0.04806669056415558,
      "rmse_dx": 0.03298913314938545,
      "rmse_dy": 0.008105997927486897,
      "rmse_mean": 0.02972060814499855,
      "rotation_flip": 0.016233766451478004,
      "sparse_tokens": 5475.0,
      "step": 5218,
      "turn_loss": 0.21569272875785828,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2424735179334696,
      "grad_norm": 0.8520165085792542,
      "learning_rate": 6.10413197359708e-06,
      "loss": 0.1802,
      "mae_dtheta": 0.015151400119066238,
      "mae_dx": 0.003547344822436571,
      "mae_dy": 0.00402110768482089,
      "pose_mae_dtheta": 0.11059261113405228,
      "pose_mae_dx": 0.041610825806856155,
      "pose_mae_dy": 0.04612636938691139,
      "pose_rmse_dtheta": 0.25155043601989746,
      "pose_rmse_dx": 0.11263208836317062,
      "pose_rmse_dy": 0.10595208406448364,
      "pose_rmse_mean": 0.15671154856681824,
      "rmse_dtheta": 0.03135542571544647,
      "rmse_dx": 0.010670636780560017,
      "rmse_dy": 0.008628200739622116,
      "rmse_mean": 0.016884755343198776,
      "rotation_flip": 0.008164714090526104,
      "sparse_tokens": 32105.0,
      "step": 5219,
      "turn_loss": 0.16382329165935516,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.24251997769931238,
      "grad_norm": 0.4346170723438263,
      "learning_rate": 6.102842357326071e-06,
      "loss": 0.1048,
      "mae_dtheta": 0.013462645933032036,
      "mae_dx": 0.0031103722285479307,
      "mae_dy": 0.004548846744000912,
      "pose_mae_dtheta": 0.09635654091835022,
      "pose_mae_dx": 0.03282202035188675,
      "pose_mae_dy": 0.03656112030148506,
      "pose_rmse_dtheta": 0.20185314118862152,
      "pose_rmse_dx": 0.08233839273452759,
      "pose_rmse_dy": 0.08050493896007538,
      "pose_rmse_mean": 0.12156550586223602,
      "rmse_dtheta": 0.028380529955029488,
      "rmse_dx": 0.008156470023095608,
      "rmse_dy": 0.010435678996145725,
      "rmse_mean": 0.015657559037208557,
      "rotation_flip": 0.005244755186140537,
      "sparse_tokens": 32137.0,
      "step": 5220,
      "turn_loss": 0.141288623213768,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.2425664374651552,
      "grad_norm": 0.5503121614456177,
      "learning_rate": 6.101552663932704e-06,
      "loss": 0.1539,
      "mae_dtheta": 0.03262965753674507,
      "mae_dx": 0.01640663668513298,
      "mae_dy": 0.0034843350294977427,
      "pose_mae_dtheta": 0.24861925840377808,
      "pose_mae_dx": 0.14449279010295868,
      "pose_mae_dy": 0.041887909173965454,
      "pose_rmse_dtheta": 0.42539823055267334,
      "pose_rmse_dx": 0.31250685453414917,
      "pose_rmse_dy": 0.09111890941858292,
      "pose_rmse_mean": 0.27634134888648987,
      "rmse_dtheta": 0.04977835714817047,
      "rmse_dx": 0.03091316856443882,
      "rmse_dy": 0.00681791827082634,
      "rmse_mean": 0.02916981279850006,
      "rotation_flip": 0.012471655383706093,
      "sparse_tokens": 17144.0,
      "step": 5221,
      "turn_loss": 0.21894049644470215,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.24261289723099796,
      "grad_norm": 0.5251221656799316,
      "learning_rate": 6.100262893507168e-06,
      "loss": 0.1366,
      "mae_dtheta": 0.01175739523023367,
      "mae_dx": 0.002940579317510128,
      "mae_dy": 0.0041021546348929405,
      "pose_mae_dtheta": 0.08443744480609894,
      "pose_mae_dx": 0.03881368041038513,
      "pose_mae_dy": 0.033091992139816284,
      "pose_rmse_dtheta": 0.2005813866853714,
      "pose_rmse_dx": 0.10289350897073746,
      "pose_rmse_dy": 0.07560737431049347,
      "pose_rmse_mean": 0.12636075913906097,
      "rmse_dtheta": 0.02413761615753174,
      "rmse_dx": 0.0077275666408240795,
      "rmse_dy": 0.008578293956816196,
      "rmse_mean": 0.013481158763170242,
      "rotation_flip": 0.004297114908695221,
      "sparse_tokens": 32169.0,
      "step": 5222,
      "turn_loss": 0.11649482697248459,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.24265935699684074,
      "grad_norm": 0.5973742604255676,
      "learning_rate": 6.098973046139658e-06,
      "loss": 0.1109,
      "mae_dtheta": 0.03600267320871353,
      "mae_dx": 0.009829764254391193,
      "mae_dy": 0.005012175068259239,
      "pose_mae_dtheta": 0.28398340940475464,
      "pose_mae_dx": 0.08364468812942505,
      "pose_mae_dy": 0.060930825769901276,
      "pose_rmse_dtheta": 0.4955722987651825,
      "pose_rmse_dx": 0.19285331666469574,
      "pose_rmse_dy": 0.13979129493236542,
      "pose_rmse_mean": 0.27607232332229614,
      "rmse_dtheta": 0.05475703254342079,
      "rmse_dx": 0.021124083548784256,
      "rmse_dy": 0.01004818920046091,
      "rmse_mean": 0.028643101453781128,
      "rotation_flip": 0.006768189370632172,
      "sparse_tokens": 19427.0,
      "step": 5223,
      "turn_loss": 0.2732078731060028,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.24270581676268352,
      "grad_norm": 0.42733460664749146,
      "learning_rate": 6.097683121920373e-06,
      "loss": 0.0908,
      "mae_dtheta": 0.025600744411349297,
      "mae_dx": 0.009983393363654613,
      "mae_dy": 0.005298539064824581,
      "pose_mae_dtheta": 0.20353050529956818,
      "pose_mae_dx": 0.07830323278903961,
      "pose_mae_dy": 0.0839499831199646,
      "pose_rmse_dtheta": 0.4112132787704468,
      "pose_rmse_dx": 0.19785076379776,
      "pose_rmse_dy": 0.18184944987297058,
      "pose_rmse_mean": 0.26363784074783325,
      "rmse_dtheta": 0.04273156449198723,
      "rmse_dx": 0.024078313261270523,
      "rmse_dy": 0.008864879608154297,
      "rmse_mean": 0.025224920362234116,
      "rotation_flip": 0.01515151560306549,
      "sparse_tokens": 7692.0,
      "step": 5224,
      "turn_loss": 0.21302911639213562,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2427522765285263,
      "grad_norm": 0.457562118768692,
      "learning_rate": 6.0963931209395165e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.014359484426677227,
      "mae_dx": 0.004064139444380999,
      "mae_dy": 0.00468779681250453,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.45756232738494873,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.3924560546875,
      "model/head/act_norm_mean": 99.34347380050505,
      "model/head/act_norm_min": 46.741539001464844,
      "model/head/act_over_embed": 68.26976526396226,
      "model/head/grad_frac": 0.11414392292499542,
      "model/head/grad_norm": 0.05222795903682709,
      "model/head/grad_zero_frac": 0.00013737867993768305,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7040078519570707,
      "model/head/update_ratio": 0.0008940178086049855,
      "model/head/weight_delta": 8.4490966796875,
      "model/head/weight_delta_rel": 0.1482221782207489,
      "model/head/weight_norm": 58.41937255859375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42041730880737305,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4203509201649495,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42028093338012695,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2888690877246709,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1170399859547615,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05355308949947357,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5430625682314411,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017319697653874755,
      "model/modality_embedder.encoders.pose/weight_delta": 2.7608652114868164,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0902060717344284,
      "model/modality_embedder.encoders.pose/weight_norm": 30.920337677001953,
      "model/modality_embedder/grad_frac": 0.1170399859547615,
      "model/modality_embedder/grad_norm": 0.05355308949947357,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5430625682314411,
      "model/modality_embedder/update_ratio": 0.0017319697653874755,
      "model/modality_embedder/weight_delta": 2.7608652114868164,
      "model/modality_embedder/weight_delta_rel": 0.0902060717344284,
      "model/modality_embedder/weight_norm": 30.920337677001953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.3917007446289,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.737203383036718,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.123188018798828,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.62521903387471,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07520689070224762,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03441184014081955,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012368687894195318,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.095442533493042,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07635919004678726,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.821739196777344,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.03727722167969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.755939854898187,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.529642105102539,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.32530427489903,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07886600494384766,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03608611226081848,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012215393362566829,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.656705856323242,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.092030368745327,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.541507720947266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.83848571777344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.6765547338464,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.866887092590332,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.645168800792035,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08486562222242355,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03883131220936775,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012732470640912652,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.8589117527008057,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.0959969013929367,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.497859954833984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.71448516845703,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.696543811127146,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.560093879699707,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.03332420613506,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09587129950523376,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.043867096304893494,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014733027201145887,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.4420742988586426,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08345851302146912,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.77466583251953,
      "model/normalizer/grad_frac": 0.3656995892524719,
      "model/normalizer/grad_norm": 0.16733035445213318,
      "model/normalizer/grad_zero_frac": 0.00015953468391671777,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002134285168722272,
      "model/normalizer/weight_delta": 5.176243305206299,
      "model/normalizer/weight_delta_rel": 0.06666702032089233,
      "model/normalizer/weight_norm": 78.401123046875,
      "pose_mae_dtheta": 0.09685607254505157,
      "pose_mae_dx": 0.04308276250958443,
      "pose_mae_dy": 0.04426902160048485,
      "pose_rmse_dtheta": 0.2067861258983612,
      "pose_rmse_dx": 0.09637490659952164,
      "pose_rmse_dy": 0.10073183476924896,
      "pose_rmse_mean": 0.1346309632062912,
      "rmse_dtheta": 0.026752116158604622,
      "rmse_dx": 0.010502532124519348,
      "rmse_dy": 0.00963010173290968,
      "rmse_mean": 0.015628250315785408,
      "rotation_flip": 0.007411982864141464,
      "sparse_tokens": 32153.0,
      "step": 5225,
      "turn_loss": 0.15330207347869873,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24279873629436907,
      "grad_norm": 0.6137809157371521,
      "learning_rate": 6.095103043287303e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.013193808495998383,
      "mae_dx": 0.0024710448924452066,
      "mae_dy": 0.0026763153728097677,
      "pose_mae_dtheta": 0.09172890335321426,
      "pose_mae_dx": 0.027725141495466232,
      "pose_mae_dy": 0.03414572402834892,
      "pose_rmse_dtheta": 0.23954655230045319,
      "pose_rmse_dx": 0.07157782465219498,
      "pose_rmse_dy": 0.08895216882228851,
      "pose_rmse_mean": 0.13335886597633362,
      "rmse_dtheta": 0.028622953221201897,
      "rmse_dx": 0.008214312605559826,
      "rmse_dy": 0.007036981172859669,
      "rmse_mean": 0.01462474837899208,
      "rotation_flip": 0.0024937656708061695,
      "sparse_tokens": 32121.0,
      "step": 5226,
      "turn_loss": 0.09248486906290054,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.24284519606021185,
      "grad_norm": 0.462015837430954,
      "learning_rate": 6.093812889053945e-06,
      "loss": 0.1253,
      "mae_dtheta": 0.028659775853157043,
      "mae_dx": 0.007860129699110985,
      "mae_dy": 0.004308533854782581,
      "pose_mae_dtheta": 0.2009880542755127,
      "pose_mae_dx": 0.04447602108120918,
      "pose_mae_dy": 0.0695585310459137,
      "pose_rmse_dtheta": 0.49878570437431335,
      "pose_rmse_dx": 0.11808133125305176,
      "pose_rmse_dy": 0.17710477113723755,
      "pose_rmse_mean": 0.26465728878974915,
      "rmse_dtheta": 0.05114598944783211,
      "rmse_dx": 0.019721239805221558,
      "rmse_dy": 0.009849512949585915,
      "rmse_mean": 0.02690557949244976,
      "rotation_flip": 0.016393441706895828,
      "sparse_tokens": 3689.0,
      "step": 5227,
      "turn_loss": 0.25726401805877686,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24289165582605463,
      "grad_norm": 0.4479934871196747,
      "learning_rate": 6.092522658329664e-06,
      "loss": 0.1001,
      "mae_dtheta": 0.010820498690009117,
      "mae_dx": 0.0018768210429698229,
      "mae_dy": 0.002558776643127203,
      "pose_mae_dtheta": 0.07323871552944183,
      "pose_mae_dx": 0.02578691579401493,
      "pose_mae_dy": 0.030555851757526398,
      "pose_rmse_dtheta": 0.1594647616147995,
      "pose_rmse_dx": 0.06483260542154312,
      "pose_rmse_dy": 0.07078900188207626,
      "pose_rmse_mean": 0.09836213290691376,
      "rmse_dtheta": 0.023145699873566628,
      "rmse_dx": 0.005214445758610964,
      "rmse_dy": 0.005525929853320122,
      "rmse_mean": 0.011295358650386333,
      "rotation_flip": 0.006576543673872948,
      "sparse_tokens": 32121.0,
      "step": 5228,
      "turn_loss": 0.08814167976379395,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.24293811559189743,
      "grad_norm": 0.3873817026615143,
      "learning_rate": 6.091232351204688e-06,
      "loss": 0.0846,
      "mae_dtheta": 0.007793540135025978,
      "mae_dx": 0.0021346171852201223,
      "mae_dy": 0.0018833280773833394,
      "pose_mae_dtheta": 0.05246122553944588,
      "pose_mae_dx": 0.023282358422875404,
      "pose_mae_dy": 0.02195669896900654,
      "pose_rmse_dtheta": 0.12816032767295837,
      "pose_rmse_dx": 0.06327728182077408,
      "pose_rmse_dy": 0.05516758933663368,
      "pose_rmse_mean": 0.08220173418521881,
      "rmse_dtheta": 0.018243620172142982,
      "rmse_dx": 0.006499520502984524,
      "rmse_dy": 0.004775964189320803,
      "rmse_mean": 0.00983970146626234,
      "rotation_flip": 0.003610108280554414,
      "sparse_tokens": 32089.0,
      "step": 5229,
      "turn_loss": 0.07293283939361572,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2429845753577402,
      "grad_norm": 0.52115797996521,
      "learning_rate": 6.089941967769246e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.010654876008629799,
      "mae_dx": 0.0019497727043926716,
      "mae_dy": 0.002817773027345538,
      "pose_mae_dtheta": 0.07141875475645065,
      "pose_mae_dx": 0.022305728867650032,
      "pose_mae_dy": 0.026927761733531952,
      "pose_rmse_dtheta": 0.14160127937793732,
      "pose_rmse_dx": 0.05284968018531799,
      "pose_rmse_dy": 0.053258270025253296,
      "pose_rmse_mean": 0.08256974816322327,
      "rmse_dtheta": 0.020136117935180664,
      "rmse_dx": 0.00555158918723464,
      "rmse_dy": 0.005695404019206762,
      "rmse_mean": 0.01046103797852993,
      "rotation_flip": 0.00561797758564353,
      "sparse_tokens": 32137.0,
      "step": 5230,
      "turn_loss": 0.09403884410858154,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.24303103512358298,
      "grad_norm": 0.44877269864082336,
      "learning_rate": 6.088651508113579e-06,
      "loss": 0.1048,
      "mae_dtheta": 0.03714021295309067,
      "mae_dx": 0.012067935429513454,
      "mae_dy": 0.005044213496148586,
      "pose_mae_dtheta": 0.25910675525665283,
      "pose_mae_dx": 0.09144435822963715,
      "pose_mae_dy": 0.06687753647565842,
      "pose_rmse_dtheta": 0.458665132522583,
      "pose_rmse_dx": 0.22893285751342773,
      "pose_rmse_dy": 0.12947046756744385,
      "pose_rmse_mean": 0.27235615253448486,
      "rmse_dtheta": 0.054419029504060745,
      "rmse_dx": 0.025309212505817413,
      "rmse_dy": 0.008538110181689262,
      "rmse_mean": 0.02942211925983429,
      "rotation_flip": 0.028260869905352592,
      "sparse_tokens": 8134.0,
      "step": 5231,
      "turn_loss": 0.3030826449394226,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.24307749488942576,
      "grad_norm": 0.456758975982666,
      "learning_rate": 6.087360972327927e-06,
      "loss": 0.1236,
      "mae_dtheta": 0.00887450110167265,
      "mae_dx": 0.0017528845928609371,
      "mae_dy": 0.0016625653952360153,
      "pose_mae_dtheta": 0.060112837702035904,
      "pose_mae_dx": 0.017794687300920486,
      "pose_mae_dy": 0.020793847739696503,
      "pose_rmse_dtheta": 0.1830594837665558,
      "pose_rmse_dx": 0.04664507508277893,
      "pose_rmse_dy": 0.05453980714082718,
      "pose_rmse_mean": 0.0947481244802475,
      "rmse_dtheta": 0.022511612623929977,
      "rmse_dx": 0.005255528260022402,
      "rmse_dy": 0.0037365781608968973,
      "rmse_mean": 0.010501239448785782,
      "rotation_flip": 0.005314437672495842,
      "sparse_tokens": 32169.0,
      "step": 5232,
      "turn_loss": 0.07073561102151871,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21034.0,
      "epoch": 0.24312395465526854,
      "grad_norm": 0.917455792427063,
      "learning_rate": 6.08607036050254e-06,
      "loss": 0.2669,
      "mae_dtheta": 0.03737877309322357,
      "mae_dx": 0.013193604536354542,
      "mae_dy": 0.005503757391124964,
      "pose_mae_dtheta": 0.29858216643333435,
      "pose_mae_dx": 0.10532064735889435,
      "pose_mae_dy": 0.07126118242740631,
      "pose_rmse_dtheta": 0.5478720664978027,
      "pose_rmse_dx": 0.24103887379169464,
      "pose_rmse_dy": 0.13363684713840485,
      "pose_rmse_mean": 0.3075159192085266,
      "rmse_dtheta": 0.05571145564317703,
      "rmse_dx": 0.02670479007065296,
      "rmse_dy": 0.009183092974126339,
      "rmse_mean": 0.030533112585544586,
      "rotation_flip": 0.01252609584480524,
      "sparse_tokens": 16707.0,
      "step": 5233,
      "turn_loss": 0.2825683653354645,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.24317041442111131,
      "grad_norm": 0.4019205570220947,
      "learning_rate": 6.084779672727669e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.005926553159952164,
      "mae_dx": 0.0015214415034279227,
      "mae_dy": 0.0011674333363771439,
      "pose_mae_dtheta": 0.04174240306019783,
      "pose_mae_dx": 0.015281087718904018,
      "pose_mae_dy": 0.013099108822643757,
      "pose_rmse_dtheta": 0.10324156284332275,
      "pose_rmse_dx": 0.04816632345318794,
      "pose_rmse_dy": 0.034581609070301056,
      "pose_rmse_mean": 0.06199650093913078,
      "rmse_dtheta": 0.013806294649839401,
      "rmse_dx": 0.005267447326332331,
      "rmse_dy": 0.002501953626051545,
      "rmse_mean": 0.007191898301243782,
      "rotation_flip": 0.0036930651403963566,
      "sparse_tokens": 32201.0,
      "step": 5234,
      "turn_loss": 0.05145836994051933,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2432168741869541,
      "grad_norm": 0.5784019827842712,
      "learning_rate": 6.083488909093573e-06,
      "loss": 0.088,
      "mae_dtheta": 0.011502640321850777,
      "mae_dx": 0.0026412433944642544,
      "mae_dy": 0.0030012759380042553,
      "pose_mae_dtheta": 0.08268220722675323,
      "pose_mae_dx": 0.024039551615715027,
      "pose_mae_dy": 0.029950007796287537,
      "pose_rmse_dtheta": 0.20126892626285553,
      "pose_rmse_dx": 0.06298516690731049,
      "pose_rmse_dy": 0.06624633818864822,
      "pose_rmse_mean": 0.11016681045293808,
      "rmse_dtheta": 0.023678798228502274,
      "rmse_dx": 0.007507436443120241,
      "rmse_dy": 0.007390892133116722,
      "rmse_mean": 0.012859041802585125,
      "rotation_flip": 0.009365687146782875,
      "sparse_tokens": 32105.0,
      "step": 5235,
      "turn_loss": 0.10869719833135605,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.24326333395279687,
      "grad_norm": 0.7380419373512268,
      "learning_rate": 6.0821980696905145e-06,
      "loss": 0.1938,
      "mae_dtheta": 0.0382971465587616,
      "mae_dx": 0.012523775920271873,
      "mae_dy": 0.005384390242397785,
      "pose_mae_dtheta": 0.3355981111526489,
      "pose_mae_dx": 0.09928765147924423,
      "pose_mae_dy": 0.0635911375284195,
      "pose_rmse_dtheta": 0.5541406273841858,
      "pose_rmse_dx": 0.22144725918769836,
      "pose_rmse_dy": 0.18469806015491486,
      "pose_rmse_mean": 0.32009533047676086,
      "rmse_dtheta": 0.05669977515935898,
      "rmse_dx": 0.024568021297454834,
      "rmse_dy": 0.012078591622412205,
      "rmse_mean": 0.031115463003516197,
      "rotation_flip": 0.020442930981516838,
      "sparse_tokens": 9943.0,
      "step": 5236,
      "turn_loss": 0.35422974824905396,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.24330979371863964,
      "grad_norm": 0.5350842475891113,
      "learning_rate": 6.080907154608766e-06,
      "loss": 0.107,
      "mae_dtheta": 0.04095113277435303,
      "mae_dx": 0.008957307785749435,
      "mae_dy": 0.004611338954418898,
      "pose_mae_dtheta": 0.369365394115448,
      "pose_mae_dx": 0.07864409685134888,
      "pose_mae_dy": 0.07987911999225616,
      "pose_rmse_dtheta": 0.6055745482444763,
      "pose_rmse_dx": 0.1662200391292572,
      "pose_rmse_dy": 0.17025800049304962,
      "pose_rmse_mean": 0.31401753425598145,
      "rmse_dtheta": 0.058265235275030136,
      "rmse_dx": 0.019704822450876236,
      "rmse_dy": 0.008334122598171234,
      "rmse_mean": 0.028768060728907585,
      "rotation_flip": 0.007662835065275431,
      "sparse_tokens": 4139.0,
      "step": 5237,
      "turn_loss": 0.2853003740310669,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.24335625348448245,
      "grad_norm": 0.397494375705719,
      "learning_rate": 6.079616163938599e-06,
      "loss": 0.1132,
      "mae_dtheta": 0.04494296386837959,
      "mae_dx": 0.0163261741399765,
      "mae_dy": 0.008413180708885193,
      "pose_mae_dtheta": 0.3401027321815491,
      "pose_mae_dx": 0.1334277093410492,
      "pose_mae_dy": 0.11036234349012375,
      "pose_rmse_dtheta": 0.5824812054634094,
      "pose_rmse_dx": 0.26551300287246704,
      "pose_rmse_dy": 0.2858883738517761,
      "pose_rmse_mean": 0.37796086072921753,
      "rmse_dtheta": 0.06377437710762024,
      "rmse_dx": 0.029146797955036163,
      "rmse_dy": 0.015130694955587387,
      "rmse_mean": 0.036017291247844696,
      "rotation_flip": 0.010389610193669796,
      "sparse_tokens": 6297.0,
      "step": 5238,
      "turn_loss": 0.34674766659736633,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.24340271325032523,
      "grad_norm": 0.45283451676368713,
      "learning_rate": 6.078325097770296e-06,
      "loss": 0.1422,
      "mae_dtheta": 0.012587161734700203,
      "mae_dx": 0.0026158085092902184,
      "mae_dy": 0.003792545758187771,
      "pose_mae_dtheta": 0.0894073098897934,
      "pose_mae_dx": 0.0359141081571579,
      "pose_mae_dy": 0.03556244820356369,
      "pose_rmse_dtheta": 0.22461417317390442,
      "pose_rmse_dx": 0.09731835871934891,
      "pose_rmse_dy": 0.09125920385122299,
      "pose_rmse_mean": 0.13773058354854584,
      "rmse_dtheta": 0.02717968076467514,
      "rmse_dx": 0.006614204961806536,
      "rmse_dy": 0.00931217335164547,
      "rmse_mean": 0.014368685893714428,
      "rotation_flip": 0.003328402293846011,
      "sparse_tokens": 32153.0,
      "step": 5239,
      "turn_loss": 0.12090471386909485,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.243449173016168,
      "grad_norm": 0.6426259279251099,
      "learning_rate": 6.0770339561941395e-06,
      "loss": 0.1691,
      "mae_dtheta": 0.01620752178132534,
      "mae_dx": 0.0032287321519106627,
      "mae_dy": 0.003804577048867941,
      "pose_mae_dtheta": 0.11562486737966537,
      "pose_mae_dx": 0.030949722975492477,
      "pose_mae_dy": 0.04316079244017601,
      "pose_rmse_dtheta": 0.28301486372947693,
      "pose_rmse_dx": 0.0836293175816536,
      "pose_rmse_dy": 0.09854820370674133,
      "pose_rmse_mean": 0.15506413578987122,
      "rmse_dtheta": 0.03210436552762985,
      "rmse_dx": 0.00991816259920597,
      "rmse_dy": 0.009559296071529388,
      "rmse_mean": 0.01719394139945507,
      "rotation_flip": 0.005988024175167084,
      "sparse_tokens": 32153.0,
      "step": 5240,
      "turn_loss": 0.1551317423582077,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.24349563278201078,
      "grad_norm": 0.42232295870780945,
      "learning_rate": 6.07574273930042e-06,
      "loss": 0.1063,
      "mae_dtheta": 0.010636500082910061,
      "mae_dx": 0.002514318795874715,
      "mae_dy": 0.0037061802577227354,
      "pose_mae_dtheta": 0.07095011323690414,
      "pose_mae_dx": 0.030850624665617943,
      "pose_mae_dy": 0.027842096984386444,
      "pose_rmse_dtheta": 0.19408802688121796,
      "pose_rmse_dx": 0.07569412142038345,
      "pose_rmse_dy": 0.06930554658174515,
      "pose_rmse_mean": 0.11302923411130905,
      "rmse_dtheta": 0.025862334296107292,
      "rmse_dx": 0.00634288415312767,
      "rmse_dy": 0.009301702491939068,
      "rmse_mean": 0.013835640624165535,
      "rotation_flip": 0.005299632903188467,
      "sparse_tokens": 32137.0,
      "step": 5241,
      "turn_loss": 0.10771410167217255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.24354209254785356,
      "grad_norm": 0.42640221118927,
      "learning_rate": 6.074451447179433e-06,
      "loss": 0.0884,
      "mae_dtheta": 0.009001649916172028,
      "mae_dx": 0.0014947481686249375,
      "mae_dy": 0.0020507131703197956,
      "pose_mae_dtheta": 0.06388580799102783,
      "pose_mae_dx": 0.019937103614211082,
      "pose_mae_dy": 0.023877864703536034,
      "pose_rmse_dtheta": 0.18259809911251068,
      "pose_rmse_dx": 0.05171734467148781,
      "pose_rmse_dy": 0.06191893666982651,
      "pose_rmse_mean": 0.09874479472637177,
      "rmse_dtheta": 0.021826105192303658,
      "rmse_dx": 0.0037268889136612415,
      "rmse_dy": 0.0047633894719183445,
      "rmse_mean": 0.01010546088218689,
      "rotation_flip": 0.002959552686661482,
      "sparse_tokens": 32201.0,
      "step": 5242,
      "turn_loss": 0.06680696457624435,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16241.0,
      "epoch": 0.24358855231369633,
      "grad_norm": 1.2456858158111572,
      "learning_rate": 6.073160079921478e-06,
      "loss": 0.2236,
      "mae_dtheta": 0.02265501208603382,
      "mae_dx": 0.010353714227676392,
      "mae_dy": 0.003372511360794306,
      "pose_mae_dtheta": 0.15811572968959808,
      "pose_mae_dx": 0.08105169236660004,
      "pose_mae_dy": 0.05334937572479248,
      "pose_rmse_dtheta": 0.3316587507724762,
      "pose_rmse_dx": 0.23011374473571777,
      "pose_rmse_dy": 0.11620576679706573,
      "pose_rmse_mean": 0.22599273920059204,
      "rmse_dtheta": 0.0390780046582222,
      "rmse_dx": 0.025033188983798027,
      "rmse_dy": 0.005613865330815315,
      "rmse_mean": 0.023241687566041946,
      "rotation_flip": 0.007407407276332378,
      "sparse_tokens": 13658.0,
      "step": 5243,
      "turn_loss": 0.2053491771221161,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.2436350120795391,
      "grad_norm": 0.4834674298763275,
      "learning_rate": 6.071868637616864e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.030385123565793037,
      "mae_dx": 0.013036418706178665,
      "mae_dy": 0.004099726211279631,
      "pose_mae_dtheta": 0.20691430568695068,
      "pose_mae_dx": 0.10852023214101791,
      "pose_mae_dy": 0.042746491730213165,
      "pose_rmse_dtheta": 0.38986918330192566,
      "pose_rmse_dx": 0.2393212616443634,
      "pose_rmse_dy": 0.09808461368083954,
      "pose_rmse_mean": 0.24242502450942993,
      "rmse_dtheta": 0.05019368976354599,
      "rmse_dx": 0.026022404432296753,
      "rmse_dy": 0.008118696510791779,
      "rmse_mean": 0.028111597523093224,
      "rotation_flip": 0.01866977848112583,
      "sparse_tokens": 13746.0,
      "step": 5244,
      "turn_loss": 0.23155143857002258,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2436814718453819,
      "grad_norm": 0.43087124824523926,
      "learning_rate": 6.070577120355903e-06,
      "loss": 0.1234,
      "mae_dtheta": 0.00918665248900652,
      "mae_dx": 0.0016210100147873163,
      "mae_dy": 0.0014919544337317348,
      "pose_mae_dtheta": 0.06687559932470322,
      "pose_mae_dx": 0.016264816746115685,
      "pose_mae_dy": 0.01870395988225937,
      "pose_rmse_dtheta": 0.23246684670448303,
      "pose_rmse_dx": 0.046157289296388626,
      "pose_rmse_dy": 0.04812522977590561,
      "pose_rmse_mean": 0.10891646146774292,
      "rmse_dtheta": 0.02594735659658909,
      "rmse_dx": 0.005484251771122217,
      "rmse_dy": 0.004433019552379847,
      "rmse_mean": 0.011954876594245434,
      "rotation_flip": 0.0018645121017470956,
      "sparse_tokens": 32089.0,
      "step": 5245,
      "turn_loss": 0.08167910575866699,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2437279316112247,
      "grad_norm": 0.5735257267951965,
      "learning_rate": 6.069285528228908e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.011123169213533401,
      "mae_dx": 0.0022765900939702988,
      "mae_dy": 0.003211829112842679,
      "pose_mae_dtheta": 0.06966659426689148,
      "pose_mae_dx": 0.028061605989933014,
      "pose_mae_dy": 0.03391096740961075,
      "pose_rmse_dtheta": 0.1654880940914154,
      "pose_rmse_dx": 0.09203437715768814,
      "pose_rmse_dy": 0.09589878469705582,
      "pose_rmse_mean": 0.11780708283185959,
      "rmse_dtheta": 0.0238709207624197,
      "rmse_dx": 0.008667970076203346,
      "rmse_dy": 0.008185235783457756,
      "rmse_mean": 0.013574710115790367,
      "rotation_flip": 0.005135227460414171,
      "sparse_tokens": 32121.0,
      "step": 5246,
      "turn_loss": 0.11111486703157425,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34063.0,
      "epoch": 0.24377439137706747,
      "grad_norm": 0.5272098183631897,
      "learning_rate": 6.0679938613262015e-06,
      "loss": 0.1437,
      "mae_dtheta": 0.023861262947320938,
      "mae_dx": 0.009967724792659283,
      "mae_dy": 0.002965517109259963,
      "pose_mae_dtheta": 0.17906677722930908,
      "pose_mae_dx": 0.075394406914711,
      "pose_mae_dy": 0.040384482592344284,
      "pose_rmse_dtheta": 0.3524012863636017,
      "pose_rmse_dx": 0.1973578780889511,
      "pose_rmse_dy": 0.10114523023366928,
      "pose_rmse_mean": 0.2169681191444397,
      "rmse_dtheta": 0.03996213525533676,
      "rmse_dx": 0.02273165062069893,
      "rmse_dy": 0.0061344257555902,
      "rmse_mean": 0.022942740470170975,
      "rotation_flip": 0.007936508394777775,
      "sparse_tokens": 26380.0,
      "step": 5247,
      "turn_loss": 0.18190892040729523,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.24382085114291024,
      "grad_norm": 0.4785291254520416,
      "learning_rate": 6.06670211973811e-06,
      "loss": 0.0875,
      "mae_dtheta": 0.008930760435760021,
      "mae_dx": 0.0015021089930087328,
      "mae_dy": 0.0018187487730756402,
      "pose_mae_dtheta": 0.057274170219898224,
      "pose_mae_dx": 0.017401570454239845,
      "pose_mae_dy": 0.022847536951303482,
      "pose_rmse_dtheta": 0.12647882103919983,
      "pose_rmse_dx": 0.04616639018058777,
      "pose_rmse_dy": 0.04856690764427185,
      "pose_rmse_mean": 0.07373737543821335,
      "rmse_dtheta": 0.018810635432600975,
      "rmse_dx": 0.004879598971456289,
      "rmse_dy": 0.003970414865761995,
      "rmse_mean": 0.009220216423273087,
      "rotation_flip": 0.004684838000684977,
      "sparse_tokens": 32105.0,
      "step": 5248,
      "turn_loss": 0.0798078179359436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24386731090875302,
      "grad_norm": 0.4216005206108093,
      "learning_rate": 6.0654103035549686e-06,
      "loss": 0.0883,
      "mae_dtheta": 0.0074174730107188225,
      "mae_dx": 0.0010640760883688927,
      "mae_dy": 0.002004310954362154,
      "pose_mae_dtheta": 0.05120866745710373,
      "pose_mae_dx": 0.012994433753192425,
      "pose_mae_dy": 0.023236308246850967,
      "pose_rmse_dtheta": 0.11985350400209427,
      "pose_rmse_dx": 0.0368792898952961,
      "pose_rmse_dy": 0.06756428629159927,
      "pose_rmse_mean": 0.07476569712162018,
      "rmse_dtheta": 0.017267517745494843,
      "rmse_dx": 0.003220214508473873,
      "rmse_dy": 0.0057203564792871475,
      "rmse_mean": 0.00873603019863367,
      "rotation_flip": 0.006734006572514772,
      "sparse_tokens": 32073.0,
      "step": 5249,
      "turn_loss": 0.07977833598852158,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2439137706745958,
      "grad_norm": 0.4310223460197449,
      "learning_rate": 6.064118412867111e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.013554851524531841,
      "mae_dx": 0.0021421359851956367,
      "mae_dy": 0.002808431861922145,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4310223460197449,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.48214721679688,
      "model/head/act_norm_mean": 111.54308712121212,
      "model/head/act_norm_min": 65.643310546875,
      "model/head/act_over_embed": 76.65345375253155,
      "model/head/grad_frac": 0.09953592717647552,
      "model/head/grad_norm": 0.04290220886468887,
      "model/head/grad_zero_frac": 0.00019163214892614633,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6958895596590909,
      "model/head/update_ratio": 0.0007343384204432368,
      "model/head/weight_delta": 8.465412139892578,
      "model/head/weight_delta_rel": 0.14850839972496033,
      "model/head/weight_norm": 58.42293930053711,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42049509286880493,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42041882754422494,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4203368127346039,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2889157543114679,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0662178099155426,
      "model/modality_embedder.encoders.pose/grad_norm": 0.028541356325149536,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5495680754405287,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009230584837496281,
      "model/modality_embedder.encoders.pose/weight_delta": 2.765366792678833,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09035315364599228,
      "model/modality_embedder.encoders.pose/weight_norm": 30.920419692993164,
      "model/modality_embedder/grad_frac": 0.0662178099155426,
      "model/modality_embedder/grad_norm": 0.028541356325149536,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5495680754405287,
      "model/modality_embedder/update_ratio": 0.0009230584837496281,
      "model/modality_embedder/weight_delta": 2.765366792678833,
      "model/modality_embedder/weight_delta_rel": 0.09035315364599228,
      "model/modality_embedder/weight_norm": 30.920419692993164,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.1097640991211,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.77737944925445,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.017684936523438,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.340037764861297,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07404636591672897,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03191563859581947,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011470767203718424,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.1016006469726562,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07658359408378601,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.823455810546875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.32416534423828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.81816177649511,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.411706924438477,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.055273124098747,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07840950787067413,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03379625082015991,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011439287336543202,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.6644279956817627,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09229786694049835,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.544017791748047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.19291687011719,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.703355479397146,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.720115661621094,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.350795886194543,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07990193367004395,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03443951904773712,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011291553964838386,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.867248296737671,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09627682715654373,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.500246047973633,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.63606262207031,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.503437149270482,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.30463695526123,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.58782886236161,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08659882843494415,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03732603043317795,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012535499408841133,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.4493248462677,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08370629698038101,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.776260375976562,
      "model/normalizer/grad_frac": 0.29026782512664795,
      "model/normalizer/grad_norm": 0.125111922621727,
      "model/normalizer/grad_zero_frac": 0.00014299034955911338,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0015957406722009182,
      "model/normalizer/weight_delta": 5.191472053527832,
      "model/normalizer/weight_delta_rel": 0.06686315685510635,
      "model/normalizer/weight_norm": 78.40367126464844,
      "pose_mae_dtheta": 0.0910448431968689,
      "pose_mae_dx": 0.030335525050759315,
      "pose_mae_dy": 0.03444986417889595,
      "pose_rmse_dtheta": 0.1983366459608078,
      "pose_rmse_dx": 0.0713532418012619,
      "pose_rmse_dy": 0.0754181519150734,
      "pose_rmse_mean": 0.1150360107421875,
      "rmse_dtheta": 0.026121284812688828,
      "rmse_dx": 0.006109038833528757,
      "rmse_dy": 0.005398225970566273,
      "rmse_mean": 0.012542850337922573,
      "rotation_flip": 0.004791238810867071,
      "sparse_tokens": 32137.0,
      "step": 5250,
      "turn_loss": 0.1188131794333458,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.24396023044043857,
      "grad_norm": 0.5204169154167175,
      "learning_rate": 6.062826447764883e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.02533462457358837,
      "mae_dx": 0.015497816726565361,
      "mae_dy": 0.004058792721480131,
      "pose_mae_dtheta": 0.20444411039352417,
      "pose_mae_dx": 0.1220724955201149,
      "pose_mae_dy": 0.048391979187726974,
      "pose_rmse_dtheta": 0.35221046209335327,
      "pose_rmse_dx": 0.30054470896720886,
      "pose_rmse_dy": 0.1143253967165947,
      "pose_rmse_mean": 0.2556935250759125,
      "rmse_dtheta": 0.040397316217422485,
      "rmse_dx": 0.03073004260659218,
      "rmse_dy": 0.008685321547091007,
      "rmse_mean": 0.026604225859045982,
      "rotation_flip": 0.0117647061124444,
      "sparse_tokens": 3192.0,
      "step": 5251,
      "turn_loss": 0.3308887183666229,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.24400669020628135,
      "grad_norm": 0.7334163188934326,
      "learning_rate": 6.061534408338632e-06,
      "loss": 0.1353,
      "mae_dtheta": 0.03983643278479576,
      "mae_dx": 0.015484805218875408,
      "mae_dy": 0.004399388562887907,
      "pose_mae_dtheta": 0.3299136459827423,
      "pose_mae_dx": 0.11270065605640411,
      "pose_mae_dy": 0.05374065041542053,
      "pose_rmse_dtheta": 0.5673697590827942,
      "pose_rmse_dx": 0.2559165358543396,
      "pose_rmse_dy": 0.1212431788444519,
      "pose_rmse_mean": 0.31484317779541016,
      "rmse_dtheta": 0.059130389243364334,
      "rmse_dx": 0.02878428064286709,
      "rmse_dy": 0.008267485536634922,
      "rmse_mean": 0.03206072002649307,
      "rotation_flip": 0.016286645084619522,
      "sparse_tokens": 11024.0,
      "step": 5252,
      "turn_loss": 0.2917540371417999,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.24405314997212413,
      "grad_norm": 0.9899005889892578,
      "learning_rate": 6.06024229467871e-06,
      "loss": 0.205,
      "mae_dtheta": 0.0317096970975399,
      "mae_dx": 0.009575378149747849,
      "mae_dy": 0.0038500127848237753,
      "pose_mae_dtheta": 0.2497439831495285,
      "pose_mae_dx": 0.07695705443620682,
      "pose_mae_dy": 0.053855836391448975,
      "pose_rmse_dtheta": 0.45396888256073,
      "pose_rmse_dx": 0.17763769626617432,
      "pose_rmse_dy": 0.12380052357912064,
      "pose_rmse_mean": 0.25180238485336304,
      "rmse_dtheta": 0.05117432400584221,
      "rmse_dx": 0.021663136780261993,
      "rmse_dy": 0.00804202351719141,
      "rmse_mean": 0.026959827169775963,
      "rotation_flip": 0.014137606136500835,
      "sparse_tokens": 17090.0,
      "step": 5253,
      "turn_loss": 0.2233186513185501,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.24409960973796693,
      "grad_norm": 0.6226007342338562,
      "learning_rate": 6.058950106875474e-06,
      "loss": 0.0932,
      "mae_dtheta": 0.032142773270606995,
      "mae_dx": 0.013897311873733997,
      "mae_dy": 0.005577840376645327,
      "pose_mae_dtheta": 0.24148572981357574,
      "pose_mae_dx": 0.11288268119096756,
      "pose_mae_dy": 0.07238418608903885,
      "pose_rmse_dtheta": 0.44870316982269287,
      "pose_rmse_dx": 0.2397102415561676,
      "pose_rmse_dy": 0.17885111272335052,
      "pose_rmse_mean": 0.2890881896018982,
      "rmse_dtheta": 0.04960179328918457,
      "rmse_dx": 0.02706911787390709,
      "rmse_dy": 0.010602511465549469,
      "rmse_mean": 0.029091142117977142,
      "rotation_flip": 0.02255639061331749,
      "sparse_tokens": 9719.0,
      "step": 5254,
      "turn_loss": 0.27725234627723694,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2441460695038097,
      "grad_norm": 0.8187363743782043,
      "learning_rate": 6.057657845019288e-06,
      "loss": 0.1617,
      "mae_dtheta": 0.009931054897606373,
      "mae_dx": 0.0020151895005255938,
      "mae_dy": 0.002060690661892295,
      "pose_mae_dtheta": 0.07110937684774399,
      "pose_mae_dx": 0.025341656059026718,
      "pose_mae_dy": 0.026588913053274155,
      "pose_rmse_dtheta": 0.1911967396736145,
      "pose_rmse_dx": 0.07097773998975754,
      "pose_rmse_dy": 0.07026149332523346,
      "pose_rmse_mean": 0.1108119934797287,
      "rmse_dtheta": 0.025093547999858856,
      "rmse_dx": 0.006331863813102245,
      "rmse_dy": 0.0055032046511769295,
      "rmse_mean": 0.012309539131820202,
      "rotation_flip": 0.002775208093225956,
      "sparse_tokens": 32089.0,
      "step": 5255,
      "turn_loss": 0.07759354263544083,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2441925292696525,
      "grad_norm": 0.37245747447013855,
      "learning_rate": 6.056365509200523e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.01219953689724207,
      "mae_dx": 0.002082895953208208,
      "mae_dy": 0.0027537615969777107,
      "pose_mae_dtheta": 0.0865054652094841,
      "pose_mae_dx": 0.02303161285817623,
      "pose_mae_dy": 0.03609013184905052,
      "pose_rmse_dtheta": 0.19332720339298248,
      "pose_rmse_dx": 0.059329308569431305,
      "pose_rmse_dy": 0.07721219211816788,
      "pose_rmse_mean": 0.10995623469352722,
      "rmse_dtheta": 0.02466103620827198,
      "rmse_dx": 0.007047457154840231,
      "rmse_dy": 0.007084030658006668,
      "rmse_mean": 0.012930842116475105,
      "rotation_flip": 0.004098360426723957,
      "sparse_tokens": 32121.0,
      "step": 5256,
      "turn_loss": 0.10015074163675308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.24423898903549526,
      "grad_norm": 0.5920332670211792,
      "learning_rate": 6.055073099509549e-06,
      "loss": 0.2083,
      "mae_dtheta": 0.04531140625476837,
      "mae_dx": 0.008981644175946712,
      "mae_dy": 0.004301899112761021,
      "pose_mae_dtheta": 0.418758362531662,
      "pose_mae_dx": 0.05674605444073677,
      "pose_mae_dy": 0.04283050820231438,
      "pose_rmse_dtheta": 0.6888971924781799,
      "pose_rmse_dx": 0.12811295688152313,
      "pose_rmse_dy": 0.1267176866531372,
      "pose_rmse_mean": 0.3145759701728821,
      "rmse_dtheta": 0.06661546975374222,
      "rmse_dx": 0.01941544935107231,
      "rmse_dy": 0.010647978633642197,
      "rmse_mean": 0.03222630172967911,
      "rotation_flip": 0.012048192322254181,
      "sparse_tokens": 4809.0,
      "step": 5257,
      "turn_loss": 0.25857269763946533,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.24428544880133804,
      "grad_norm": 0.418488085269928,
      "learning_rate": 6.053780616036749e-06,
      "loss": 0.0975,
      "mae_dtheta": 0.010658884420990944,
      "mae_dx": 0.0016287524485960603,
      "mae_dy": 0.0018362837145105004,
      "pose_mae_dtheta": 0.07415968179702759,
      "pose_mae_dx": 0.020839489996433258,
      "pose_mae_dy": 0.027418214827775955,
      "pose_rmse_dtheta": 0.16902658343315125,
      "pose_rmse_dx": 0.05176703259348869,
      "pose_rmse_dy": 0.06536374241113663,
      "pose_rmse_mean": 0.09538578987121582,
      "rmse_dtheta": 0.02240831032395363,
      "rmse_dx": 0.005340174306184053,
      "rmse_dy": 0.0037662824615836143,
      "rmse_mean": 0.010504922829568386,
      "rotation_flip": 0.0032284099142998457,
      "sparse_tokens": 32089.0,
      "step": 5258,
      "turn_loss": 0.071795754134655,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.24433190856718082,
      "grad_norm": 1.0973589420318604,
      "learning_rate": 6.052488058872503e-06,
      "loss": 0.2353,
      "mae_dtheta": 0.03787916898727417,
      "mae_dx": 0.028491860255599022,
      "mae_dy": 0.011052546091377735,
      "pose_mae_dtheta": 0.29179033637046814,
      "pose_mae_dx": 0.20681019127368927,
      "pose_mae_dy": 0.17791955173015594,
      "pose_rmse_dtheta": 0.48894262313842773,
      "pose_rmse_dx": 0.3677747845649719,
      "pose_rmse_dy": 0.3196174204349518,
      "pose_rmse_mean": 0.3921116292476654,
      "rmse_dtheta": 0.05110328644514084,
      "rmse_dx": 0.043663714081048965,
      "rmse_dy": 0.01570037007331848,
      "rmse_mean": 0.03682246059179306,
      "rotation_flip": 0.02575107291340828,
      "sparse_tokens": 3545.0,
      "step": 5259,
      "turn_loss": 0.4664939045906067,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2443783683330236,
      "grad_norm": 0.42756712436676025,
      "learning_rate": 6.0511954281072036e-06,
      "loss": 0.0902,
      "mae_dtheta": 0.011977067217230797,
      "mae_dx": 0.002980245742946863,
      "mae_dy": 0.0038570421747863293,
      "pose_mae_dtheta": 0.08363273739814758,
      "pose_mae_dx": 0.03232038393616676,
      "pose_mae_dy": 0.03736375644803047,
      "pose_rmse_dtheta": 0.21171224117279053,
      "pose_rmse_dx": 0.085818812251091,
      "pose_rmse_dy": 0.11811009794473648,
      "pose_rmse_mean": 0.13854706287384033,
      "rmse_dtheta": 0.02456793375313282,
      "rmse_dx": 0.008747301995754242,
      "rmse_dy": 0.011079825460910797,
      "rmse_mean": 0.014798353426158428,
      "rotation_flip": 0.00728407921269536,
      "sparse_tokens": 32121.0,
      "step": 5260,
      "turn_loss": 0.12412162125110626,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.24442482809886637,
      "grad_norm": 0.6095808744430542,
      "learning_rate": 6.049902723831243e-06,
      "loss": 0.0773,
      "mae_dtheta": 0.02737063355743885,
      "mae_dx": 0.009888902306556702,
      "mae_dy": 0.0035595835652202368,
      "pose_mae_dtheta": 0.2262997031211853,
      "pose_mae_dx": 0.0912378802895546,
      "pose_mae_dy": 0.05003143474459648,
      "pose_rmse_dtheta": 0.4621308743953705,
      "pose_rmse_dx": 0.21987320482730865,
      "pose_rmse_dy": 0.10053364187479019,
      "pose_rmse_mean": 0.26084592938423157,
      "rmse_dtheta": 0.04797672852873802,
      "rmse_dx": 0.022174101322889328,
      "rmse_dy": 0.006912322249263525,
      "rmse_mean": 0.025687716901302338,
      "rotation_flip": 0.016025641933083534,
      "sparse_tokens": 7031.0,
      "step": 5261,
      "turn_loss": 0.2173585742712021,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.24447128786470917,
      "grad_norm": 0.5386128425598145,
      "learning_rate": 6.04860994613502e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.010115872137248516,
      "mae_dx": 0.001803850056603551,
      "mae_dy": 0.002089189365506172,
      "pose_mae_dtheta": 0.07066872715950012,
      "pose_mae_dx": 0.017956051975488663,
      "pose_mae_dy": 0.023070236667990685,
      "pose_rmse_dtheta": 0.17468784749507904,
      "pose_rmse_dx": 0.049605369567871094,
      "pose_rmse_dy": 0.05905407294631004,
      "pose_rmse_mean": 0.09444909542798996,
      "rmse_dtheta": 0.02335570752620697,
      "rmse_dx": 0.005517350044101477,
      "rmse_dy": 0.006454937160015106,
      "rmse_mean": 0.011775998398661613,
      "rotation_flip": 0.006663705222308636,
      "sparse_tokens": 32137.0,
      "step": 5262,
      "turn_loss": 0.08418579399585724,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.24451774763055195,
      "grad_norm": 0.3755336105823517,
      "learning_rate": 6.047317095108943e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.010510713793337345,
      "mae_dx": 0.001351741375401616,
      "mae_dy": 0.001615725108422339,
      "pose_mae_dtheta": 0.06921151280403137,
      "pose_mae_dx": 0.02090642601251602,
      "pose_mae_dy": 0.024493249133229256,
      "pose_rmse_dtheta": 0.19940334558486938,
      "pose_rmse_dx": 0.058121077716350555,
      "pose_rmse_dy": 0.0677320584654808,
      "pose_rmse_mean": 0.10841883718967438,
      "rmse_dtheta": 0.026173876598477364,
      "rmse_dx": 0.004225973971188068,
      "rmse_dy": 0.003918436821550131,
      "rmse_mean": 0.011439429596066475,
      "rotation_flip": 0.0022522523067891598,
      "sparse_tokens": 32105.0,
      "step": 5263,
      "turn_loss": 0.06429094821214676,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.24456420739639473,
      "grad_norm": 0.5253430604934692,
      "learning_rate": 6.046024170843418e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.01940566673874855,
      "mae_dx": 0.010014179162681103,
      "mae_dy": 0.002493460662662983,
      "pose_mae_dtheta": 0.1229853481054306,
      "pose_mae_dx": 0.07099255174398422,
      "pose_mae_dy": 0.03355030715465546,
      "pose_rmse_dtheta": 0.23620162904262543,
      "pose_rmse_dx": 0.17829689383506775,
      "pose_rmse_dy": 0.08119537681341171,
      "pose_rmse_mean": 0.16523130238056183,
      "rmse_dtheta": 0.03456313908100128,
      "rmse_dx": 0.022466862574219704,
      "rmse_dy": 0.004720568656921387,
      "rmse_mean": 0.02058352343738079,
      "rotation_flip": 0.0054054055362939835,
      "sparse_tokens": 7326.0,
      "step": 5264,
      "turn_loss": 0.15643569827079773,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2446106671622375,
      "grad_norm": 0.4487597644329071,
      "learning_rate": 6.044731173428862e-06,
      "loss": 0.1345,
      "mae_dtheta": 0.01013573631644249,
      "mae_dx": 0.0018287193961441517,
      "mae_dy": 0.002365663181990385,
      "pose_mae_dtheta": 0.07028251141309738,
      "pose_mae_dx": 0.021759044378995895,
      "pose_mae_dy": 0.029012462124228477,
      "pose_rmse_dtheta": 0.15071120858192444,
      "pose_rmse_dx": 0.05204078555107117,
      "pose_rmse_dy": 0.06454870849847794,
      "pose_rmse_mean": 0.08910023421049118,
      "rmse_dtheta": 0.01991036720573902,
      "rmse_dx": 0.005647318437695503,
      "rmse_dy": 0.00467657670378685,
      "rmse_mean": 0.010078087449073792,
      "rotation_flip": 0.002964060753583908,
      "sparse_tokens": 32105.0,
      "step": 5265,
      "turn_loss": 0.08170601725578308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24465712692808028,
      "grad_norm": 0.6202349662780762,
      "learning_rate": 6.0434381029556945e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.006299447733908892,
      "mae_dx": 0.001241109101101756,
      "mae_dy": 0.0015292390016838908,
      "pose_mae_dtheta": 0.03950095176696777,
      "pose_mae_dx": 0.015106841921806335,
      "pose_mae_dy": 0.019097335636615753,
      "pose_rmse_dtheta": 0.087905153632164,
      "pose_rmse_dx": 0.041417837142944336,
      "pose_rmse_dy": 0.04752584546804428,
      "pose_rmse_mean": 0.05894961208105087,
      "rmse_dtheta": 0.01529125776141882,
      "rmse_dx": 0.004155983682721853,
      "rmse_dy": 0.0037831685040146112,
      "rmse_mean": 0.007743469905108213,
      "rotation_flip": 0.0056151095777750015,
      "sparse_tokens": 32073.0,
      "step": 5266,
      "turn_loss": 0.05728517845273018,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24470358669392306,
      "grad_norm": 0.537280261516571,
      "learning_rate": 6.04214495951434e-06,
      "loss": 0.093,
      "mae_dtheta": 0.009706821292638779,
      "mae_dx": 0.0023523690178990364,
      "mae_dy": 0.002593651646748185,
      "pose_mae_dtheta": 0.07457844913005829,
      "pose_mae_dx": 0.022532779723405838,
      "pose_mae_dy": 0.027362214401364326,
      "pose_rmse_dtheta": 0.21678081154823303,
      "pose_rmse_dx": 0.07514539361000061,
      "pose_rmse_dy": 0.08065171539783478,
      "pose_rmse_mean": 0.12419264018535614,
      "rmse_dtheta": 0.02352040633559227,
      "rmse_dx": 0.008455149829387665,
      "rmse_dy": 0.008020645938813686,
      "rmse_mean": 0.013332067988812923,
      "rotation_flip": 0.00671140942722559,
      "sparse_tokens": 32073.0,
      "step": 5267,
      "turn_loss": 0.09391196817159653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.24475004645976584,
      "grad_norm": 0.47163909673690796,
      "learning_rate": 6.040851743195228e-06,
      "loss": 0.1452,
      "mae_dtheta": 0.031005093827843666,
      "mae_dx": 0.017132841050624847,
      "mae_dy": 0.011661455035209656,
      "pose_mae_dtheta": 0.20079468190670013,
      "pose_mae_dx": 0.11783256381750107,
      "pose_mae_dy": 0.17350652813911438,
      "pose_rmse_dtheta": 0.35724833607673645,
      "pose_rmse_dx": 0.21726465225219727,
      "pose_rmse_dy": 0.30807843804359436,
      "pose_rmse_mean": 0.294197142124176,
      "rmse_dtheta": 0.04687754437327385,
      "rmse_dx": 0.030177146196365356,
      "rmse_dy": 0.02105671726167202,
      "rmse_mean": 0.03270380571484566,
      "rotation_flip": 0.015673981979489326,
      "sparse_tokens": 5952.0,
      "step": 5268,
      "turn_loss": 0.44528788328170776,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.2447965062256086,
      "grad_norm": 0.475509911775589,
      "learning_rate": 6.039558454088796e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.04382665082812309,
      "mae_dx": 0.010680215433239937,
      "mae_dy": 0.006946284789592028,
      "pose_mae_dtheta": 0.4257838726043701,
      "pose_mae_dx": 0.09944551438093185,
      "pose_mae_dy": 0.06376221776008606,
      "pose_rmse_dtheta": 0.6301857829093933,
      "pose_rmse_dx": 0.19686894118785858,
      "pose_rmse_dy": 0.16030406951904297,
      "pose_rmse_mean": 0.32911962270736694,
      "rmse_dtheta": 0.05881080776453018,
      "rmse_dx": 0.02078557386994362,
      "rmse_dy": 0.01536097377538681,
      "rmse_mean": 0.031652454286813736,
      "rotation_flip": 0.013513513840734959,
      "sparse_tokens": 7111.0,
      "step": 5269,
      "turn_loss": 0.42293423414230347,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.24484296599145142,
      "grad_norm": 0.46856367588043213,
      "learning_rate": 6.038265092285484e-06,
      "loss": 0.089,
      "mae_dtheta": 0.017510728910565376,
      "mae_dx": 0.002201609779149294,
      "mae_dy": 0.0058068507350981236,
      "pose_mae_dtheta": 0.09442074596881866,
      "pose_mae_dx": 0.029179878532886505,
      "pose_mae_dy": 0.054628584533929825,
      "pose_rmse_dtheta": 0.15712079405784607,
      "pose_rmse_dx": 0.066617451608181,
      "pose_rmse_dy": 0.1152331754565239,
      "pose_rmse_mean": 0.11299048364162445,
      "rmse_dtheta": 0.0278236772865057,
      "rmse_dx": 0.0060293893329799175,
      "rmse_dy": 0.012130028568208218,
      "rmse_mean": 0.015327698551118374,
      "rotation_flip": 0.01607717014849186,
      "sparse_tokens": 4835.0,
      "step": 5270,
      "turn_loss": 0.1441376507282257,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2448894257572942,
      "grad_norm": 0.5382497906684875,
      "learning_rate": 6.036971657875736e-06,
      "loss": 0.098,
      "mae_dtheta": 0.007149729877710342,
      "mae_dx": 0.0020944508723914623,
      "mae_dy": 0.001751418225467205,
      "pose_mae_dtheta": 0.04820263385772705,
      "pose_mae_dx": 0.02297677844762802,
      "pose_mae_dy": 0.020848581567406654,
      "pose_rmse_dtheta": 0.11662997305393219,
      "pose_rmse_dx": 0.06848999857902527,
      "pose_rmse_dy": 0.05348874628543854,
      "pose_rmse_mean": 0.07953624427318573,
      "rmse_dtheta": 0.0173298642039299,
      "rmse_dx": 0.007220874074846506,
      "rmse_dy": 0.004327691160142422,
      "rmse_mean": 0.009626142680644989,
      "rotation_flip": 0.0032912781462073326,
      "sparse_tokens": 32089.0,
      "step": 5271,
      "turn_loss": 0.06698518991470337,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.24493588552313697,
      "grad_norm": 0.5166926980018616,
      "learning_rate": 6.035678150950005e-06,
      "loss": 0.1106,
      "mae_dtheta": 0.03153415024280548,
      "mae_dx": 0.012599284760653973,
      "mae_dy": 0.008265293203294277,
      "pose_mae_dtheta": 0.2132156789302826,
      "pose_mae_dx": 0.07397425174713135,
      "pose_mae_dy": 0.10681190341711044,
      "pose_rmse_dtheta": 0.3520619869232178,
      "pose_rmse_dx": 0.1623755246400833,
      "pose_rmse_dy": 0.20826102793216705,
      "pose_rmse_mean": 0.24089950323104858,
      "rmse_dtheta": 0.04435890167951584,
      "rmse_dx": 0.024862032383680344,
      "rmse_dy": 0.013932984322309494,
      "rmse_mean": 0.02771797403693199,
      "rotation_flip": 0.01315789483487606,
      "sparse_tokens": 3821.0,
      "step": 5272,
      "turn_loss": 0.31441670656204224,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.24498234528897975,
      "grad_norm": 0.6939698457717896,
      "learning_rate": 6.034384571598744e-06,
      "loss": 0.1979,
      "mae_dtheta": 0.036994535475969315,
      "mae_dx": 0.020006494596600533,
      "mae_dy": 0.009259927086532116,
      "pose_mae_dtheta": 0.2657506465911865,
      "pose_mae_dx": 0.14186382293701172,
      "pose_mae_dy": 0.11196591705083847,
      "pose_rmse_dtheta": 0.4520559310913086,
      "pose_rmse_dx": 0.28973519802093506,
      "pose_rmse_dy": 0.24173592031002045,
      "pose_rmse_mean": 0.3278423547744751,
      "rmse_dtheta": 0.053345996886491776,
      "rmse_dx": 0.03493703529238701,
      "rmse_dy": 0.017806315794587135,
      "rmse_mean": 0.03536311537027359,
      "rotation_flip": 0.011834319680929184,
      "sparse_tokens": 7978.0,
      "step": 5273,
      "turn_loss": 0.45939943194389343,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.24502880505482252,
      "grad_norm": 0.5797717571258545,
      "learning_rate": 6.033090919912414e-06,
      "loss": 0.1167,
      "mae_dtheta": 0.03331833705306053,
      "mae_dx": 0.013450542464852333,
      "mae_dy": 0.005404842551797628,
      "pose_mae_dtheta": 0.27845606207847595,
      "pose_mae_dx": 0.10999452322721481,
      "pose_mae_dy": 0.06209078058600426,
      "pose_rmse_dtheta": 0.4297316074371338,
      "pose_rmse_dx": 0.21972087025642395,
      "pose_rmse_dy": 0.13410058617591858,
      "pose_rmse_mean": 0.26118433475494385,
      "rmse_dtheta": 0.04736773669719696,
      "rmse_dx": 0.02581101842224598,
      "rmse_dy": 0.009105001576244831,
      "rmse_mean": 0.02742791920900345,
      "rotation_flip": 0.013392857275903225,
      "sparse_tokens": 11428.0,
      "step": 5274,
      "turn_loss": 0.28432270884513855,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2450752648206653,
      "grad_norm": 0.41610175371170044,
      "learning_rate": 6.031797195981481e-06,
      "loss": 0.0944,
      "mae_dtheta": 0.008874105289578438,
      "mae_dx": 0.0014576988760381937,
      "mae_dy": 0.0020645507611334324,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4161018431186676,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.38475036621094,
      "model/head/act_norm_mean": 117.53716856060606,
      "model/head/act_norm_min": 70.72063446044922,
      "model/head/act_over_embed": 80.77264263515764,
      "model/head/grad_frac": 0.10055271536111832,
      "model/head/grad_norm": 0.041840169578790665,
      "model/head/grad_zero_frac": 0.00020939936803188175,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6979807844065656,
      "model/head/update_ratio": 0.0007161082467064261,
      "model/head/weight_delta": 8.482892990112305,
      "model/head/weight_delta_rel": 0.1488150656223297,
      "model/head/weight_norm": 58.42715835571289,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42047297954559326,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.420401848687066,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4203419089317322,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2889040862818697,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11637455970048904,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04842367023229599,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5276041666666667,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015660161152482033,
      "model/modality_embedder.encoders.pose/weight_delta": 2.7730188369750977,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09060316532850266,
      "model/modality_embedder.encoders.pose/weight_norm": 30.921566009521484,
      "model/modality_embedder/grad_frac": 0.11637455970048904,
      "model/modality_embedder/grad_norm": 0.04842367023229599,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5276041666666667,
      "model/modality_embedder/update_ratio": 0.0015660161152482033,
      "model/modality_embedder/weight_delta": 2.7730188369750977,
      "model/modality_embedder/weight_delta_rel": 0.09060316532850266,
      "model/modality_embedder/weight_norm": 30.921566009521484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.20819854736328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.33077300785634,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.09747314453125,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.72033499928464,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0771721675992012,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.032111480832099915,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011540503473952413,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.1074647903442383,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07679729163646698,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.82502555847168,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.26970672607422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.392160694244026,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.078397750854492,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.449730554238336,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08209599554538727,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03416029363870621,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011561621213331819,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.671882152557373,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09255608916282654,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.546283721923828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.12203216552734,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.310450737534072,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.133309364318848,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.767997431301595,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0823732316493988,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03427565470337868,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001123680267482996,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.875565767288208,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09655611217021942,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.503032684326172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.01681518554688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.061056998557,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.134060859680176,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.971030443310585,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09331770241260529,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03882966935634613,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001303980010561645,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.4564177989959717,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08394870162010193,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.77781105041504,
      "model/normalizer/grad_frac": 0.3652563691139221,
      "model/normalizer/grad_norm": 0.151983842253685,
      "model/normalizer/grad_zero_frac": 0.00020325901277828962,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0019384148763492703,
      "model/normalizer/weight_delta": 5.206269264221191,
      "model/normalizer/weight_delta_rel": 0.06705373525619507,
      "model/normalizer/weight_norm": 78.40625,
      "pose_mae_dtheta": 0.057296156883239746,
      "pose_mae_dx": 0.015934644266963005,
      "pose_mae_dy": 0.02165859006345272,
      "pose_rmse_dtheta": 0.127839595079422,
      "pose_rmse_dx": 0.03688376396894455,
      "pose_rmse_dy": 0.05851316452026367,
      "pose_rmse_mean": 0.07441218197345734,
      "rmse_dtheta": 0.019472243264317513,
      "rmse_dx": 0.004030721262097359,
      "rmse_dy": 0.0055413153022527695,
      "rmse_mean": 0.009681426919996738,
      "rotation_flip": 0.0060192616656422615,
      "sparse_tokens": 32121.0,
      "step": 5275,
      "turn_loss": 0.07419039309024811,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7468.0,
      "epoch": 0.24512172458650808,
      "grad_norm": 0.5744542479515076,
      "learning_rate": 6.030503399896418e-06,
      "loss": 0.1132,
      "mae_dtheta": 0.041870202869176865,
      "mae_dx": 0.011192770674824715,
      "mae_dy": 0.006150171626359224,
      "pose_mae_dtheta": 0.28948038816452026,
      "pose_mae_dx": 0.08780888468027115,
      "pose_mae_dy": 0.06643660366535187,
      "pose_rmse_dtheta": 0.5582132339477539,
      "pose_rmse_dx": 0.22729338705539703,
      "pose_rmse_dy": 0.16556093096733093,
      "pose_rmse_mean": 0.31702253222465515,
      "rmse_dtheta": 0.0635966807603836,
      "rmse_dx": 0.02423286624252796,
      "rmse_dy": 0.014427759684622288,
      "rmse_mean": 0.03408576920628548,
      "rotation_flip": 0.023376623168587685,
      "sparse_tokens": 6367.0,
      "step": 5276,
      "turn_loss": 0.2766959071159363,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.24516818435235085,
      "grad_norm": 0.6675899624824524,
      "learning_rate": 6.029209531747699e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.035066768527030945,
      "mae_dx": 0.009447308257222176,
      "mae_dy": 0.006596510764211416,
      "pose_mae_dtheta": 0.2869153320789337,
      "pose_mae_dx": 0.0736330971121788,
      "pose_mae_dy": 0.06512187421321869,
      "pose_rmse_dtheta": 0.5335481762886047,
      "pose_rmse_dx": 0.15168055891990662,
      "pose_rmse_dy": 0.16897381842136383,
      "pose_rmse_mean": 0.28473418951034546,
      "rmse_dtheta": 0.05620413273572922,
      "rmse_dx": 0.01957148313522339,
      "rmse_dy": 0.016888005658984184,
      "rmse_mean": 0.030887875705957413,
      "rotation_flip": 0.009842519648373127,
      "sparse_tokens": 8146.0,
      "step": 5277,
      "turn_loss": 0.31350430846214294,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.24521464411819363,
      "grad_norm": 0.8820093870162964,
      "learning_rate": 6.027915591625804e-06,
      "loss": 0.2989,
      "mae_dtheta": 0.037238914519548416,
      "mae_dx": 0.008931116200983524,
      "mae_dy": 0.00577527517452836,
      "pose_mae_dtheta": 0.28913602232933044,
      "pose_mae_dx": 0.09097382426261902,
      "pose_mae_dy": 0.07133051007986069,
      "pose_rmse_dtheta": 0.42003223299980164,
      "pose_rmse_dx": 0.17633208632469177,
      "pose_rmse_dy": 0.13729937374591827,
      "pose_rmse_mean": 0.2445545643568039,
      "rmse_dtheta": 0.050906505435705185,
      "rmse_dx": 0.018278485164046288,
      "rmse_dy": 0.01015482097864151,
      "rmse_mean": 0.02644660323858261,
      "rotation_flip": 0.01804511249065399,
      "sparse_tokens": 10788.0,
      "step": 5278,
      "turn_loss": 0.3025682866573334,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.24526110388403644,
      "grad_norm": 0.6050814986228943,
      "learning_rate": 6.02662157962122e-06,
      "loss": 0.1339,
      "mae_dtheta": 0.014785800129175186,
      "mae_dx": 0.0020029840525239706,
      "mae_dy": 0.0032635352108627558,
      "pose_mae_dtheta": 0.10311231017112732,
      "pose_mae_dx": 0.03301849961280823,
      "pose_mae_dy": 0.042956095188856125,
      "pose_rmse_dtheta": 0.21028921008110046,
      "pose_rmse_dx": 0.07741076499223709,
      "pose_rmse_dy": 0.09404896199703217,
      "pose_rmse_mean": 0.12724964320659637,
      "rmse_dtheta": 0.026481550186872482,
      "rmse_dx": 0.004976165015250444,
      "rmse_dy": 0.006105891428887844,
      "rmse_mean": 0.012521202675998211,
      "rotation_flip": 0.01149838324636221,
      "sparse_tokens": 32057.0,
      "step": 5279,
      "turn_loss": 0.1348898708820343,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.2453075636498792,
      "grad_norm": 0.6838438510894775,
      "learning_rate": 6.025327495824439e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.036177944391965866,
      "mae_dx": 0.013931871391832829,
      "mae_dy": 0.004486669320613146,
      "pose_mae_dtheta": 0.2879810333251953,
      "pose_mae_dx": 0.09359721839427948,
      "pose_mae_dy": 0.058686621487140656,
      "pose_rmse_dtheta": 0.5100238919258118,
      "pose_rmse_dx": 0.19592010974884033,
      "pose_rmse_dy": 0.160003200173378,
      "pose_rmse_mean": 0.2886490821838379,
      "rmse_dtheta": 0.055800534784793854,
      "rmse_dx": 0.0257839597761631,
      "rmse_dy": 0.009441902860999107,
      "rmse_mean": 0.030342135578393936,
      "rotation_flip": 0.004249291960150003,
      "sparse_tokens": 12754.0,
      "step": 5280,
      "turn_loss": 0.28276219964027405,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.245354023415722,
      "grad_norm": 0.8216115832328796,
      "learning_rate": 6.024033340325954e-06,
      "loss": 0.122,
      "mae_dtheta": 0.008505300618708134,
      "mae_dx": 0.0017603005981072783,
      "mae_dy": 0.0005974731757305562,
      "pose_mae_dtheta": 0.06451465934515,
      "pose_mae_dx": 0.015187278389930725,
      "pose_mae_dy": 0.010256155394017696,
      "pose_rmse_dtheta": 0.18652871251106262,
      "pose_rmse_dx": 0.042707398533821106,
      "pose_rmse_dy": 0.030146323144435883,
      "pose_rmse_mean": 0.08646081387996674,
      "rmse_dtheta": 0.02309117466211319,
      "rmse_dx": 0.006003757938742638,
      "rmse_dy": 0.0015391436172649264,
      "rmse_mean": 0.010211358778178692,
      "rotation_flip": 0.002388059627264738,
      "sparse_tokens": 32137.0,
      "step": 5281,
      "turn_loss": 0.06165168806910515,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.24540048318156477,
      "grad_norm": 0.6635485291481018,
      "learning_rate": 6.022739113216269e-06,
      "loss": 0.1659,
      "mae_dtheta": 0.036070022732019424,
      "mae_dx": 0.017440391704440117,
      "mae_dy": 0.006502150092273951,
      "pose_mae_dtheta": 0.2268134504556656,
      "pose_mae_dx": 0.12685845792293549,
      "pose_mae_dy": 0.08442524820566177,
      "pose_rmse_dtheta": 0.4548622667789459,
      "pose_rmse_dx": 0.26692694425582886,
      "pose_rmse_dy": 0.1977323442697525,
      "pose_rmse_mean": 0.3065072000026703,
      "rmse_dtheta": 0.05368782579898834,
      "rmse_dx": 0.031348031014204025,
      "rmse_dy": 0.014416118152439594,
      "rmse_mean": 0.03315066173672676,
      "rotation_flip": 0.01904761977493763,
      "sparse_tokens": 4663.0,
      "step": 5282,
      "turn_loss": 0.3730826675891876,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.24544694294740754,
      "grad_norm": 1.0476726293563843,
      "learning_rate": 6.021444814585888e-06,
      "loss": 0.2706,
      "mae_dtheta": 0.03980853036046028,
      "mae_dx": 0.0103529654443264,
      "mae_dy": 0.005739057902246714,
      "pose_mae_dtheta": 0.33183690905570984,
      "pose_mae_dx": 0.0850534588098526,
      "pose_mae_dy": 0.057296354323625565,
      "pose_rmse_dtheta": 0.5725230574607849,
      "pose_rmse_dx": 0.20559847354888916,
      "pose_rmse_dy": 0.1454509198665619,
      "pose_rmse_mean": 0.307857483625412,
      "rmse_dtheta": 0.0598272979259491,
      "rmse_dx": 0.0224519744515419,
      "rmse_dy": 0.012573231011629105,
      "rmse_mean": 0.031617503613233566,
      "rotation_flip": 0.0071599045768380165,
      "sparse_tokens": 21004.0,
      "step": 5283,
      "turn_loss": 0.28619998693466187,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.24549340271325032,
      "grad_norm": 0.60737544298172,
      "learning_rate": 6.0201504445253245e-06,
      "loss": 0.1637,
      "mae_dtheta": 0.025692295283079147,
      "mae_dx": 0.007429840043187141,
      "mae_dy": 0.0036450745537877083,
      "pose_mae_dtheta": 0.18233877420425415,
      "pose_mae_dx": 0.05579118803143501,
      "pose_mae_dy": 0.04362097755074501,
      "pose_rmse_dtheta": 0.35008957982063293,
      "pose_rmse_dx": 0.1330554187297821,
      "pose_rmse_dy": 0.09314420819282532,
      "pose_rmse_mean": 0.19209639728069305,
      "rmse_dtheta": 0.0432097464799881,
      "rmse_dx": 0.01827896758913994,
      "rmse_dy": 0.006510379258543253,
      "rmse_mean": 0.022666364908218384,
      "rotation_flip": 0.010843373835086823,
      "sparse_tokens": 14579.0,
      "step": 5284,
      "turn_loss": 0.22692158818244934,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.2455398624790931,
      "grad_norm": 0.4015688896179199,
      "learning_rate": 6.018856003125092e-06,
      "loss": 0.0991,
      "mae_dtheta": 0.02900506928563118,
      "mae_dx": 0.010924005880951881,
      "mae_dy": 0.006110418122261763,
      "pose_mae_dtheta": 0.22737953066825867,
      "pose_mae_dx": 0.0889320969581604,
      "pose_mae_dy": 0.07453424483537674,
      "pose_rmse_dtheta": 0.3878002166748047,
      "pose_rmse_dx": 0.20068621635437012,
      "pose_rmse_dy": 0.20181973278522491,
      "pose_rmse_mean": 0.26343539357185364,
      "rmse_dtheta": 0.044849496334791183,
      "rmse_dx": 0.02265460602939129,
      "rmse_dy": 0.013688058592379093,
      "rmse_mean": 0.02706405334174633,
      "rotation_flip": 0.006528835743665695,
      "sparse_tokens": 16418.0,
      "step": 5285,
      "turn_loss": 0.2976341247558594,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24558632224493587,
      "grad_norm": 0.6499161720275879,
      "learning_rate": 6.017561490475713e-06,
      "loss": 0.145,
      "mae_dtheta": 0.009017819538712502,
      "mae_dx": 0.001499210367910564,
      "mae_dy": 0.0022969164419919252,
      "pose_mae_dtheta": 0.05629822239279747,
      "pose_mae_dx": 0.020184841006994247,
      "pose_mae_dy": 0.02704664319753647,
      "pose_rmse_dtheta": 0.12755680084228516,
      "pose_rmse_dx": 0.05571949854493141,
      "pose_rmse_dy": 0.06918951869010925,
      "pose_rmse_mean": 0.08415527641773224,
      "rmse_dtheta": 0.019867505878210068,
      "rmse_dx": 0.0044693006202578545,
      "rmse_dy": 0.00568697415292263,
      "rmse_mean": 0.010007927194237709,
      "rotation_flip": 0.0049151028506457806,
      "sparse_tokens": 32073.0,
      "step": 5286,
      "turn_loss": 0.0716858059167862,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.24563278201077868,
      "grad_norm": 0.6376697421073914,
      "learning_rate": 6.016266906667711e-06,
      "loss": 0.1239,
      "mae_dtheta": 0.009090892039239407,
      "mae_dx": 0.0017683451296761632,
      "mae_dy": 0.0014257931616157293,
      "pose_mae_dtheta": 0.05623948574066162,
      "pose_mae_dx": 0.01990717090666294,
      "pose_mae_dy": 0.01930718496441841,
      "pose_rmse_dtheta": 0.14731468260288239,
      "pose_rmse_dx": 0.045553058385849,
      "pose_rmse_dy": 0.05195029452443123,
      "pose_rmse_mean": 0.08160601556301117,
      "rmse_dtheta": 0.02190418355166912,
      "rmse_dx": 0.004928253125399351,
      "rmse_dy": 0.0035698560532182455,
      "rmse_mean": 0.010134098120033741,
      "rotation_flip": 0.002764612901955843,
      "sparse_tokens": 32201.0,
      "step": 5287,
      "turn_loss": 0.07221947610378265,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.24567924177662145,
      "grad_norm": 1.0224636793136597,
      "learning_rate": 6.0149722517916195e-06,
      "loss": 0.2141,
      "mae_dtheta": 0.029132597148418427,
      "mae_dx": 0.012758667580783367,
      "mae_dy": 0.00485455896705389,
      "pose_mae_dtheta": 0.21711187064647675,
      "pose_mae_dx": 0.10191833227872849,
      "pose_mae_dy": 0.04882947728037834,
      "pose_rmse_dtheta": 0.3565889000892639,
      "pose_rmse_dx": 0.20539355278015137,
      "pose_rmse_dy": 0.10246793925762177,
      "pose_rmse_mean": 0.22148346900939941,
      "rmse_dtheta": 0.044123321771621704,
      "rmse_dx": 0.02415473386645317,
      "rmse_dy": 0.011669788509607315,
      "rmse_mean": 0.02664928138256073,
      "rotation_flip": 0.010330578312277794,
      "sparse_tokens": 8172.0,
      "step": 5288,
      "turn_loss": 0.211032897233963,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.24572570154246423,
      "grad_norm": 0.5029821395874023,
      "learning_rate": 6.013677525937976e-06,
      "loss": 0.0919,
      "mae_dtheta": 0.014180004596710205,
      "mae_dx": 0.002126772189512849,
      "mae_dy": 0.0029797572642564774,
      "pose_mae_dtheta": 0.10219669342041016,
      "pose_mae_dx": 0.02760516293346882,
      "pose_mae_dy": 0.041604720056056976,
      "pose_rmse_dtheta": 0.21301838755607605,
      "pose_rmse_dx": 0.0688461884856224,
      "pose_rmse_dy": 0.09615695476531982,
      "pose_rmse_mean": 0.12600718438625336,
      "rmse_dtheta": 0.02633364498615265,
      "rmse_dx": 0.00636551808565855,
      "rmse_dy": 0.006005521398037672,
      "rmse_mean": 0.01290156226605177,
      "rotation_flip": 0.008534322492778301,
      "sparse_tokens": 32105.0,
      "step": 5289,
      "turn_loss": 0.10134217143058777,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.245772161308307,
      "grad_norm": 0.4505198299884796,
      "learning_rate": 6.012382729197317e-06,
      "loss": 0.0898,
      "mae_dtheta": 0.03966516628861427,
      "mae_dx": 0.01591860130429268,
      "mae_dy": 0.003555614035576582,
      "pose_mae_dtheta": 0.3545525372028351,
      "pose_mae_dx": 0.12466893345117569,
      "pose_mae_dy": 0.027652189135551453,
      "pose_rmse_dtheta": 0.556065022945404,
      "pose_rmse_dx": 0.2584669888019562,
      "pose_rmse_dy": 0.07454603165388107,
      "pose_rmse_mean": 0.2963593602180481,
      "rmse_dtheta": 0.05478159338235855,
      "rmse_dx": 0.027348417788743973,
      "rmse_dy": 0.008208745159208775,
      "rmse_mean": 0.030112920328974724,
      "rotation_flip": 0.017543859779834747,
      "sparse_tokens": 4441.0,
      "step": 5290,
      "turn_loss": 0.26971155405044556,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 42058.0,
      "epoch": 0.24581862107414978,
      "grad_norm": 0.4893245995044708,
      "learning_rate": 6.011087861660191e-06,
      "loss": 0.1581,
      "mae_dtheta": 0.04253881052136421,
      "mae_dx": 0.012549744918942451,
      "mae_dy": 0.004970841575413942,
      "pose_mae_dtheta": 0.3521597385406494,
      "pose_mae_dx": 0.09912678599357605,
      "pose_mae_dy": 0.055961597710847855,
      "pose_rmse_dtheta": 0.5946211814880371,
      "pose_rmse_dx": 0.21072250604629517,
      "pose_rmse_dy": 0.14250652492046356,
      "pose_rmse_mean": 0.31595009565353394,
      "rmse_dtheta": 0.06270270049571991,
      "rmse_dx": 0.02417936734855175,
      "rmse_dy": 0.01138984877616167,
      "rmse_mean": 0.03275730833411217,
      "rotation_flip": 0.012633624486625195,
      "sparse_tokens": 30058.0,
      "step": 5291,
      "turn_loss": 0.3254092335700989,
      "turns": 130.0,
      "turns_per_sample": 130.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24586508083999256,
      "grad_norm": 0.42501184344291687,
      "learning_rate": 6.009792923417148e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.012401103042066097,
      "mae_dx": 0.001800280879251659,
      "mae_dy": 0.003574475646018982,
      "pose_mae_dtheta": 0.08182669430971146,
      "pose_mae_dx": 0.02745979279279709,
      "pose_mae_dy": 0.04115154966711998,
      "pose_rmse_dtheta": 0.1880173236131668,
      "pose_rmse_dx": 0.08580414950847626,
      "pose_rmse_dy": 0.11138185858726501,
      "pose_rmse_mean": 0.12840111553668976,
      "rmse_dtheta": 0.025091903284192085,
      "rmse_dx": 0.006254747975617647,
      "rmse_dy": 0.009485721588134766,
      "rmse_mean": 0.01361079141497612,
      "rotation_flip": 0.006394315976649523,
      "sparse_tokens": 32073.0,
      "step": 5292,
      "turn_loss": 0.10318420082330704,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24591154060583534,
      "grad_norm": 0.3886127769947052,
      "learning_rate": 6.0084979145587444e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.00872195977717638,
      "mae_dx": 0.0012852033833041787,
      "mae_dy": 0.002261691028252244,
      "pose_mae_dtheta": 0.06026347354054451,
      "pose_mae_dx": 0.016585487872362137,
      "pose_mae_dy": 0.027752459049224854,
      "pose_rmse_dtheta": 0.11851999163627625,
      "pose_rmse_dx": 0.04072915390133858,
      "pose_rmse_dy": 0.06060491502285004,
      "pose_rmse_mean": 0.07328468561172485,
      "rmse_dtheta": 0.016742320731282234,
      "rmse_dx": 0.004229934420436621,
      "rmse_dy": 0.004886311944574118,
      "rmse_mean": 0.008619522675871849,
      "rotation_flip": 0.004739336669445038,
      "sparse_tokens": 32073.0,
      "step": 5293,
      "turn_loss": 0.06504041701555252,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.24595800037167811,
      "grad_norm": 0.4998711049556732,
      "learning_rate": 6.0072028351755375e-06,
      "loss": 0.1376,
      "mae_dtheta": 0.008547174744307995,
      "mae_dx": 0.0023064552806317806,
      "mae_dy": 0.00147416687104851,
      "pose_mae_dtheta": 0.060436349362134933,
      "pose_mae_dx": 0.020911332219839096,
      "pose_mae_dy": 0.018550505861639977,
      "pose_rmse_dtheta": 0.17095761001110077,
      "pose_rmse_dx": 0.05240464583039284,
      "pose_rmse_dy": 0.052653152495622635,
      "pose_rmse_mean": 0.09200513362884521,
      "rmse_dtheta": 0.02241051197052002,
      "rmse_dx": 0.006422519683837891,
      "rmse_dy": 0.0036207735538482666,
      "rmse_mean": 0.010817935690283775,
      "rotation_flip": 0.006221484858542681,
      "sparse_tokens": 32233.0,
      "step": 5294,
      "turn_loss": 0.06653521209955215,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.24600446013752092,
      "grad_norm": 0.6304416060447693,
      "learning_rate": 6.005907685358098e-06,
      "loss": 0.139,
      "mae_dtheta": 0.00596221536397934,
      "mae_dx": 0.0011103604920208454,
      "mae_dy": 0.0011654902482405305,
      "pose_mae_dtheta": 0.040378719568252563,
      "pose_mae_dx": 0.014344586059451103,
      "pose_mae_dy": 0.01826329715549946,
      "pose_rmse_dtheta": 0.08079053461551666,
      "pose_rmse_dx": 0.03258872777223587,
      "pose_rmse_dy": 0.04256323352456093,
      "pose_rmse_mean": 0.05198083445429802,
      "rmse_dtheta": 0.013853560201823711,
      "rmse_dx": 0.0031560086645185947,
      "rmse_dy": 0.0024232047144323587,
      "rmse_mean": 0.006477591581642628,
      "rotation_flip": 0.002862985711544752,
      "sparse_tokens": 32137.0,
      "step": 5295,
      "turn_loss": 0.04839370399713516,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 39466.0,
      "epoch": 0.2460509199033637,
      "grad_norm": 0.3906228542327881,
      "learning_rate": 6.004612465196994e-06,
      "loss": 0.1735,
      "mae_dtheta": 0.038461070507764816,
      "mae_dx": 0.01268776785582304,
      "mae_dy": 0.003990916535258293,
      "pose_mae_dtheta": 0.32391661405563354,
      "pose_mae_dx": 0.09884283691644669,
      "pose_mae_dy": 0.04700168967247009,
      "pose_rmse_dtheta": 0.5652024149894714,
      "pose_rmse_dx": 0.20409519970417023,
      "pose_rmse_dy": 0.12188224494457245,
      "pose_rmse_mean": 0.29705995321273804,
      "rmse_dtheta": 0.057114534080028534,
      "rmse_dx": 0.023987647145986557,
      "rmse_dy": 0.00893336534500122,
      "rmse_mean": 0.030011847615242004,
      "rotation_flip": 0.010777084156870842,
      "sparse_tokens": 29866.0,
      "step": 5296,
      "turn_loss": 0.3130588233470917,
      "turns": 122.0,
      "turns_per_sample": 122.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.24609737966920647,
      "grad_norm": 0.5624117255210876,
      "learning_rate": 6.003317174782801e-06,
      "loss": 0.1712,
      "mae_dtheta": 0.038249269127845764,
      "mae_dx": 0.014295121654868126,
      "mae_dy": 0.007902507670223713,
      "pose_mae_dtheta": 0.2653595805168152,
      "pose_mae_dx": 0.11573601514101028,
      "pose_mae_dy": 0.09953207522630692,
      "pose_rmse_dtheta": 0.44797569513320923,
      "pose_rmse_dx": 0.24315710365772247,
      "pose_rmse_dy": 0.22805269062519073,
      "pose_rmse_mean": 0.30639517307281494,
      "rmse_dtheta": 0.05478054657578468,
      "rmse_dx": 0.027168454602360725,
      "rmse_dy": 0.014905763790011406,
      "rmse_mean": 0.032284922897815704,
      "rotation_flip": 0.020270269364118576,
      "sparse_tokens": 10013.0,
      "step": 5297,
      "turn_loss": 0.3208562433719635,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.24614383943504925,
      "grad_norm": 0.6578754186630249,
      "learning_rate": 6.0020218142061e-06,
      "loss": 0.0843,
      "mae_dtheta": 0.008124097250401974,
      "mae_dx": 0.00183167215436697,
      "mae_dy": 0.00022630792227573693,
      "pose_mae_dtheta": 0.06015418842434883,
      "pose_mae_dx": 0.01507007610052824,
      "pose_mae_dy": 0.003270221408456564,
      "pose_rmse_dtheta": 0.24502937495708466,
      "pose_rmse_dx": 0.034879136830568314,
      "pose_rmse_dy": 0.007059979718178511,
      "pose_rmse_mean": 0.09565617144107819,
      "rmse_dtheta": 0.029550472274422646,
      "rmse_dx": 0.004943567328155041,
      "rmse_dy": 0.00047263450687751174,
      "rmse_mean": 0.01165555790066719,
      "rotation_flip": 0.0037135279271751642,
      "sparse_tokens": 32265.0,
      "step": 5298,
      "turn_loss": 0.05500122904777527,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.24619029920089203,
      "grad_norm": 0.4496127963066101,
      "learning_rate": 6.000726383557476e-06,
      "loss": 0.0934,
      "mae_dtheta": 0.00949162058532238,
      "mae_dx": 0.0015038697747513652,
      "mae_dy": 0.0008849751320667565,
      "pose_mae_dtheta": 0.07444682717323303,
      "pose_mae_dx": 0.014604772441089153,
      "pose_mae_dy": 0.01540655829012394,
      "pose_rmse_dtheta": 0.26205113530158997,
      "pose_rmse_dx": 0.04254110902547836,
      "pose_rmse_dy": 0.04744353145360947,
      "pose_rmse_mean": 0.11734526604413986,
      "rmse_dtheta": 0.028945205733180046,
      "rmse_dx": 0.005147214978933334,
      "rmse_dy": 0.0021596287842839956,
      "rmse_mean": 0.01208401657640934,
      "rotation_flip": 0.004419191740453243,
      "sparse_tokens": 32089.0,
      "step": 5299,
      "turn_loss": 0.06574400514364243,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2462367589667348,
      "grad_norm": 0.822072446346283,
      "learning_rate": 5.999430882927516e-06,
      "loss": 0.144,
      "mae_dtheta": 0.009473882615566254,
      "mae_dx": 0.0019524517701938748,
      "mae_dy": 0.0019020066829398274,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.822072446346283,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.15176391601562,
      "model/head/act_norm_mean": 121.18802280618686,
      "model/head/act_norm_min": 61.256752014160156,
      "model/head/act_over_embed": 83.28154385255672,
      "model/head/grad_frac": 0.0941760241985321,
      "model/head/grad_norm": 0.07741951197385788,
      "model/head/grad_zero_frac": 0.00015133863780647516,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6981287484217171,
      "model/head/update_ratio": 0.0013249639887362719,
      "model/head/weight_delta": 8.498416900634766,
      "model/head/weight_delta_rel": 0.14908739924430847,
      "model/head/weight_norm": 58.4314079284668,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42066389322280884,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4205915625959505,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42051634192466736,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2890344594561847,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07423760741949081,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06102868914604187,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5412629639737991,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019736094400286674,
      "model/modality_embedder.encoders.pose/weight_delta": 2.7778854370117188,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0907621756196022,
      "model/modality_embedder.encoders.pose/weight_norm": 30.922374725341797,
      "model/modality_embedder/grad_frac": 0.07423760741949081,
      "model/modality_embedder/grad_norm": 0.06102868914604187,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5412629639737991,
      "model/modality_embedder/update_ratio": 0.0019736094400286674,
      "model/modality_embedder/weight_delta": 2.7778854370117188,
      "model/modality_embedder/weight_delta_rel": 0.0907621756196022,
      "model/modality_embedder/weight_norm": 30.922374725341797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.2127685546875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.66199695366362,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.980743408203125,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.94795519581084,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08427759259939194,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06928228586912155,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0024898150004446507,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.114182710647583,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0770420953631401,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.826278686523438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.4374771118164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.72634078884079,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.458186149597168,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.67938224388857,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08394097536802292,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0690055638551712,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0023353591095656157,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.68058443069458,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09285753965377808,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.548158645629883,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.97178649902344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.55549543049543,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.526968002319336,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.9363944384492,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0880555659532547,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07238805294036865,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0023730380926281214,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.884382724761963,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09685216844081879,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.504379272460938,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.47333526611328,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.30053761824595,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.424426078796387,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.135603767213716,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10219859331846237,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0840146467089653,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0028212531469762325,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.463203191757202,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08418059349060059,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.779193878173828,
      "model/normalizer/grad_frac": 0.4389447271823883,
      "model/normalizer/grad_norm": 0.36084437370300293,
      "model/normalizer/grad_zero_frac": 0.00013235470396466553,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004602113738656044,
      "model/normalizer/weight_delta": 5.222241401672363,
      "model/normalizer/weight_delta_rel": 0.06725944578647614,
      "model/normalizer/weight_norm": 78.40840148925781,
      "pose_mae_dtheta": 0.06769837439060211,
      "pose_mae_dx": 0.02113267406821251,
      "pose_mae_dy": 0.02602177858352661,
      "pose_rmse_dtheta": 0.18201881647109985,
      "pose_rmse_dx": 0.05189597234129906,
      "pose_rmse_dy": 0.07317575067281723,
      "pose_rmse_mean": 0.10236351937055588,
      "rmse_dtheta": 0.02132471464574337,
      "rmse_dx": 0.005789522547274828,
      "rmse_dy": 0.0038566726725548506,
      "rmse_mean": 0.01032363623380661,
      "rotation_flip": 0.00477326987311244,
      "sparse_tokens": 32153.0,
      "step": 5300,
      "turn_loss": 0.08218032121658325,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24628321873257758,
      "grad_norm": 0.47525542974472046,
      "learning_rate": 5.998135312406821e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.008236020803451538,
      "mae_dx": 0.0017484636045992374,
      "mae_dy": 0.0016706864116713405,
      "pose_mae_dtheta": 0.05710935220122337,
      "pose_mae_dx": 0.018558934330940247,
      "pose_mae_dy": 0.018876800313591957,
      "pose_rmse_dtheta": 0.15186338126659393,
      "pose_rmse_dx": 0.05522536858916283,
      "pose_rmse_dy": 0.044932715594768524,
      "pose_rmse_mean": 0.0840071588754654,
      "rmse_dtheta": 0.019149841740727425,
      "rmse_dx": 0.00622071186080575,
      "rmse_dy": 0.003664410440251231,
      "rmse_mean": 0.009678320959210396,
      "rotation_flip": 0.0016792610986158252,
      "sparse_tokens": 32121.0,
      "step": 5301,
      "turn_loss": 0.06206569820642471,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.24632967849842036,
      "grad_norm": 0.5802088379859924,
      "learning_rate": 5.996839672085986e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.011176415719091892,
      "mae_dx": 0.0021406153682619333,
      "mae_dy": 0.004126364830881357,
      "pose_mae_dtheta": 0.07543282210826874,
      "pose_mae_dx": 0.034588851034641266,
      "pose_mae_dy": 0.04343443363904953,
      "pose_rmse_dtheta": 0.14477309584617615,
      "pose_rmse_dx": 0.0849364846944809,
      "pose_rmse_dy": 0.09186165779829025,
      "pose_rmse_mean": 0.10719041526317596,
      "rmse_dtheta": 0.020373012870550156,
      "rmse_dx": 0.006106736604124308,
      "rmse_dy": 0.008870549499988556,
      "rmse_mean": 0.011783434078097343,
      "rotation_flip": 0.0034281795378774405,
      "sparse_tokens": 32041.0,
      "step": 5302,
      "turn_loss": 0.10536196082830429,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.24637613826426316,
      "grad_norm": 0.8149846792221069,
      "learning_rate": 5.995543962055619e-06,
      "loss": 0.0729,
      "mae_dtheta": 0.01954975537955761,
      "mae_dx": 0.014782908372581005,
      "mae_dy": 0.004775316454470158,
      "pose_mae_dtheta": 0.1364527940750122,
      "pose_mae_dx": 0.11917616426944733,
      "pose_mae_dy": 0.0657358393073082,
      "pose_rmse_dtheta": 0.22132454812526703,
      "pose_rmse_dx": 0.26278531551361084,
      "pose_rmse_dy": 0.13095390796661377,
      "pose_rmse_mean": 0.20502126216888428,
      "rmse_dtheta": 0.03164250776171684,
      "rmse_dx": 0.029877416789531708,
      "rmse_dy": 0.008387796580791473,
      "rmse_mean": 0.023302575573325157,
      "rotation_flip": 0.01433691754937172,
      "sparse_tokens": 5944.0,
      "step": 5303,
      "turn_loss": 0.2003527134656906,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.24642259803010594,
      "grad_norm": 0.8878240585327148,
      "learning_rate": 5.994248182406328e-06,
      "loss": 0.1229,
      "mae_dtheta": 0.009373434819281101,
      "mae_dx": 0.003730850527063012,
      "mae_dy": 0.00278842868283391,
      "pose_mae_dtheta": 0.05875164270401001,
      "pose_mae_dx": 0.0401945486664772,
      "pose_mae_dy": 0.03749817982316017,
      "pose_rmse_dtheta": 0.10069076716899872,
      "pose_rmse_dx": 0.11722961813211441,
      "pose_rmse_dy": 0.08842585235834122,
      "pose_rmse_mean": 0.10211541503667831,
      "rmse_dtheta": 0.016935741528868675,
      "rmse_dx": 0.0126864705234766,
      "rmse_dy": 0.005256572272628546,
      "rmse_mean": 0.011626261286437511,
      "rotation_flip": 0.0024837006349116564,
      "sparse_tokens": 32105.0,
      "step": 5304,
      "turn_loss": 0.1285947561264038,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.24646905779594871,
      "grad_norm": 0.5516381859779358,
      "learning_rate": 5.9929523332287275e-06,
      "loss": 0.1568,
      "mae_dtheta": 0.02645164541900158,
      "mae_dx": 0.008956290781497955,
      "mae_dy": 0.004662139806896448,
      "pose_mae_dtheta": 0.1945902556180954,
      "pose_mae_dx": 0.06826552003622055,
      "pose_mae_dy": 0.05466819182038307,
      "pose_rmse_dtheta": 0.3108300566673279,
      "pose_rmse_dx": 0.15498575568199158,
      "pose_rmse_dy": 0.11843954026699066,
      "pose_rmse_mean": 0.1947517842054367,
      "rmse_dtheta": 0.03952012583613396,
      "rmse_dx": 0.019160538911819458,
      "rmse_dy": 0.008448576554656029,
      "rmse_mean": 0.022376414388418198,
      "rotation_flip": 0.017716536298394203,
      "sparse_tokens": 9171.0,
      "step": 5305,
      "turn_loss": 0.20707820355892181,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2465155175617915,
      "grad_norm": 0.4132067859172821,
      "learning_rate": 5.991656414613437e-06,
      "loss": 0.0906,
      "mae_dtheta": 0.009246224537491798,
      "mae_dx": 0.00166334118694067,
      "mae_dy": 0.0022849813103675842,
      "pose_mae_dtheta": 0.06220961734652519,
      "pose_mae_dx": 0.02135498821735382,
      "pose_mae_dy": 0.02466999739408493,
      "pose_rmse_dtheta": 0.14799870550632477,
      "pose_rmse_dx": 0.05641184747219086,
      "pose_rmse_dy": 0.05386725813150406,
      "pose_rmse_mean": 0.08609260618686676,
      "rmse_dtheta": 0.021119149401783943,
      "rmse_dx": 0.004561199806630611,
      "rmse_dy": 0.004713293164968491,
      "rmse_mean": 0.010131213814020157,
      "rotation_flip": 0.004025764763355255,
      "sparse_tokens": 32089.0,
      "step": 5306,
      "turn_loss": 0.07803286612033844,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.24656197732763427,
      "grad_norm": 0.6202180981636047,
      "learning_rate": 5.9903604266510825e-06,
      "loss": 0.2094,
      "mae_dtheta": 0.009159274399280548,
      "mae_dx": 0.0016063943039625883,
      "mae_dy": 0.0022962926886975765,
      "pose_mae_dtheta": 0.06335720419883728,
      "pose_mae_dx": 0.0208524689078331,
      "pose_mae_dy": 0.02629031613469124,
      "pose_rmse_dtheta": 0.16017737984657288,
      "pose_rmse_dx": 0.05867435410618782,
      "pose_rmse_dy": 0.06622439622879028,
      "pose_rmse_mean": 0.09502538293600082,
      "rmse_dtheta": 0.022235378623008728,
      "rmse_dx": 0.00572185916826129,
      "rmse_dy": 0.006334909237921238,
      "rmse_mean": 0.011430716142058372,
      "rotation_flip": 0.0017809439450502396,
      "sparse_tokens": 32057.0,
      "step": 5307,
      "turn_loss": 0.0848359763622284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34930.0,
      "epoch": 0.24660843709347705,
      "grad_norm": 0.686740517616272,
      "learning_rate": 5.9890643694322915e-06,
      "loss": 0.143,
      "mae_dtheta": 0.03961660712957382,
      "mae_dx": 0.01208940427750349,
      "mae_dy": 0.004509723745286465,
      "pose_mae_dtheta": 0.32191166281700134,
      "pose_mae_dx": 0.09845162183046341,
      "pose_mae_dy": 0.050716400146484375,
      "pose_rmse_dtheta": 0.56093430519104,
      "pose_rmse_dx": 0.21233919262886047,
      "pose_rmse_dy": 0.11206559091806412,
      "pose_rmse_mean": 0.2951130270957947,
      "rmse_dtheta": 0.058808304369449615,
      "rmse_dx": 0.024378076195716858,
      "rmse_dy": 0.008930442854762077,
      "rmse_mean": 0.030705608427524567,
      "rotation_flip": 0.013375796377658844,
      "sparse_tokens": 25202.0,
      "step": 5308,
      "turn_loss": 0.28143322467803955,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24665489685931982,
      "grad_norm": 0.8883020281791687,
      "learning_rate": 5.987768243047698e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.010093392804265022,
      "mae_dx": 0.0015035775722935796,
      "mae_dy": 0.0023070862516760826,
      "pose_mae_dtheta": 0.06796763092279434,
      "pose_mae_dx": 0.02473737671971321,
      "pose_mae_dy": 0.03044557385146618,
      "pose_rmse_dtheta": 0.1675402969121933,
      "pose_rmse_dx": 0.07015474140644073,
      "pose_rmse_dy": 0.08522913604974747,
      "pose_rmse_mean": 0.10764139145612717,
      "rmse_dtheta": 0.02181493304669857,
      "rmse_dx": 0.004656534176319838,
      "rmse_dy": 0.005168580450117588,
      "rmse_mean": 0.010546683333814144,
      "rotation_flip": 0.006506709847599268,
      "sparse_tokens": 32073.0,
      "step": 5309,
      "turn_loss": 0.07683593779802322,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2467013566251626,
      "grad_norm": 0.7087652683258057,
      "learning_rate": 5.986472047587943e-06,
      "loss": 0.153,
      "mae_dtheta": 0.015865858644247055,
      "mae_dx": 0.004845066927373409,
      "mae_dy": 0.005856992676854134,
      "pose_mae_dtheta": 0.1198258325457573,
      "pose_mae_dx": 0.05345512926578522,
      "pose_mae_dy": 0.05351831391453743,
      "pose_rmse_dtheta": 0.2695358097553253,
      "pose_rmse_dx": 0.14529943466186523,
      "pose_rmse_dy": 0.13172943890094757,
      "pose_rmse_mean": 0.1821882426738739,
      "rmse_dtheta": 0.029824785888195038,
      "rmse_dx": 0.014436858706176281,
      "rmse_dy": 0.01368700060993433,
      "rmse_mean": 0.019316215068101883,
      "rotation_flip": 0.005734766833484173,
      "sparse_tokens": 32041.0,
      "step": 5310,
      "turn_loss": 0.177413210272789,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.24674781639100538,
      "grad_norm": 0.5883771777153015,
      "learning_rate": 5.985175783143666e-06,
      "loss": 0.126,
      "mae_dtheta": 0.041306670755147934,
      "mae_dx": 0.011065516620874405,
      "mae_dy": 0.004914812743663788,
      "pose_mae_dtheta": 0.3608899414539337,
      "pose_mae_dx": 0.1008981242775917,
      "pose_mae_dy": 0.03414633497595787,
      "pose_rmse_dtheta": 0.5850833654403687,
      "pose_rmse_dx": 0.20002301037311554,
      "pose_rmse_dy": 0.10853885114192963,
      "pose_rmse_mean": 0.29788175225257874,
      "rmse_dtheta": 0.06157572194933891,
      "rmse_dx": 0.02065204083919525,
      "rmse_dy": 0.01278854813426733,
      "rmse_mean": 0.03167210519313812,
      "rotation_flip": 0.013761468231678009,
      "sparse_tokens": 3604.0,
      "step": 5311,
      "turn_loss": 0.21565474569797516,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.24679427615684818,
      "grad_norm": 0.7496181130409241,
      "learning_rate": 5.983879449805519e-06,
      "loss": 0.1792,
      "mae_dtheta": 0.03982679918408394,
      "mae_dx": 0.01765536516904831,
      "mae_dy": 0.009843955747783184,
      "pose_mae_dtheta": 0.3227267563343048,
      "pose_mae_dx": 0.14420649409294128,
      "pose_mae_dy": 0.1075180321931839,
      "pose_rmse_dtheta": 0.5040605068206787,
      "pose_rmse_dx": 0.28403690457344055,
      "pose_rmse_dy": 0.27254706621170044,
      "pose_rmse_mean": 0.353548139333725,
      "rmse_dtheta": 0.056696075946092606,
      "rmse_dx": 0.030833369120955467,
      "rmse_dy": 0.020515762269496918,
      "rmse_mean": 0.03601507097482681,
      "rotation_flip": 0.011735121719539165,
      "sparse_tokens": 19121.0,
      "step": 5312,
      "turn_loss": 0.39553987979888916,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.24684073592269096,
      "grad_norm": 0.6259622573852539,
      "learning_rate": 5.982583047664151e-06,
      "loss": 0.1091,
      "mae_dtheta": 0.00879205483943224,
      "mae_dx": 0.0022999218199402094,
      "mae_dy": 0.0036510168574750423,
      "pose_mae_dtheta": 0.0606461800634861,
      "pose_mae_dx": 0.02722066640853882,
      "pose_mae_dy": 0.031080475077033043,
      "pose_rmse_dtheta": 0.1213146224617958,
      "pose_rmse_dx": 0.06729454547166824,
      "pose_rmse_dy": 0.06815412640571594,
      "pose_rmse_mean": 0.0855877622961998,
      "rmse_dtheta": 0.01776965893805027,
      "rmse_dx": 0.0058473264798521996,
      "rmse_dy": 0.007658999413251877,
      "rmse_mean": 0.010425328277051449,
      "rotation_flip": 0.003664345946162939,
      "sparse_tokens": 32089.0,
      "step": 5313,
      "turn_loss": 0.09000055491924286,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.24688719568853373,
      "grad_norm": 0.5345603227615356,
      "learning_rate": 5.981286576810225e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.00840048398822546,
      "mae_dx": 0.001757753430865705,
      "mae_dy": 0.001373653532937169,
      "pose_mae_dtheta": 0.05711216479539871,
      "pose_mae_dx": 0.017832782119512558,
      "pose_mae_dy": 0.017147090286016464,
      "pose_rmse_dtheta": 0.18640948832035065,
      "pose_rmse_dx": 0.042550839483737946,
      "pose_rmse_dy": 0.0473492294549942,
      "pose_rmse_mean": 0.09210318326950073,
      "rmse_dtheta": 0.023647446185350418,
      "rmse_dx": 0.005364631302654743,
      "rmse_dy": 0.003944077529013157,
      "rmse_mean": 0.010985384695231915,
      "rotation_flip": 0.005589194130152464,
      "sparse_tokens": 32169.0,
      "step": 5314,
      "turn_loss": 0.06571358442306519,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.2469336554543765,
      "grad_norm": 0.7335301041603088,
      "learning_rate": 5.979990037334403e-06,
      "loss": 0.1561,
      "mae_dtheta": 0.030095882713794708,
      "mae_dx": 0.01682840660214424,
      "mae_dy": 0.006563792936503887,
      "pose_mae_dtheta": 0.2256595641374588,
      "pose_mae_dx": 0.14462313055992126,
      "pose_mae_dy": 0.08232809603214264,
      "pose_rmse_dtheta": 0.36962202191352844,
      "pose_rmse_dx": 0.28384122252464294,
      "pose_rmse_dy": 0.18351991474628448,
      "pose_rmse_mean": 0.2789943814277649,
      "rmse_dtheta": 0.048336442559957504,
      "rmse_dx": 0.031097933650016785,
      "rmse_dy": 0.012301210314035416,
      "rmse_mean": 0.030578529462218285,
      "rotation_flip": 0.0200803205370903,
      "sparse_tokens": 3833.0,
      "step": 5315,
      "turn_loss": 0.22482874989509583,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.2469801152202193,
      "grad_norm": 0.720309853553772,
      "learning_rate": 5.978693429327351e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.05007348582148552,
      "mae_dx": 0.01291621383279562,
      "mae_dy": 0.003215161617845297,
      "pose_mae_dtheta": 0.4383859932422638,
      "pose_mae_dx": 0.10632669925689697,
      "pose_mae_dy": 0.0443851575255394,
      "pose_rmse_dtheta": 0.6783096194267273,
      "pose_rmse_dx": 0.2120831310749054,
      "pose_rmse_dy": 0.10730641335248947,
      "pose_rmse_mean": 0.33256641030311584,
      "rmse_dtheta": 0.06766781955957413,
      "rmse_dx": 0.023879172280430794,
      "rmse_dy": 0.006252598483115435,
      "rmse_mean": 0.03259986639022827,
      "rotation_flip": 0.018145160749554634,
      "sparse_tokens": 7706.0,
      "step": 5316,
      "turn_loss": 0.2429344803094864,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.24702657498606206,
      "grad_norm": 0.7511013150215149,
      "learning_rate": 5.977396752879742e-06,
      "loss": 0.2994,
      "mae_dtheta": 0.039922889322042465,
      "mae_dx": 0.016966594383120537,
      "mae_dy": 0.008014211431145668,
      "pose_mae_dtheta": 0.297240287065506,
      "pose_mae_dx": 0.13945196568965912,
      "pose_mae_dy": 0.08101395517587662,
      "pose_rmse_dtheta": 0.5034222602844238,
      "pose_rmse_dx": 0.2741048336029053,
      "pose_rmse_dy": 0.18693016469478607,
      "pose_rmse_mean": 0.3214857578277588,
      "rmse_dtheta": 0.057759035378694534,
      "rmse_dx": 0.029613640159368515,
      "rmse_dy": 0.01759646087884903,
      "rmse_mean": 0.03498971462249756,
      "rotation_flip": 0.018281536176800728,
      "sparse_tokens": 17904.0,
      "step": 5317,
      "turn_loss": 0.3394589126110077,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.24707303475190484,
      "grad_norm": 0.4949440062046051,
      "learning_rate": 5.976100008082254e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.009663045406341553,
      "mae_dx": 0.0015656114555895329,
      "mae_dy": 0.001501727383583784,
      "pose_mae_dtheta": 0.06063375249505043,
      "pose_mae_dx": 0.016519131138920784,
      "pose_mae_dy": 0.015881158411502838,
      "pose_rmse_dtheta": 0.21475690603256226,
      "pose_rmse_dx": 0.04124421253800392,
      "pose_rmse_dy": 0.03880215808749199,
      "pose_rmse_mean": 0.09826775640249252,
      "rmse_dtheta": 0.02697286754846573,
      "rmse_dx": 0.004740780685096979,
      "rmse_dy": 0.003651656908914447,
      "rmse_mean": 0.011788435280323029,
      "rotation_flip": 0.0013818517327308655,
      "sparse_tokens": 32137.0,
      "step": 5318,
      "turn_loss": 0.0649455115199089,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1340.0,
      "epoch": 0.24711949451774762,
      "grad_norm": 0.5458669662475586,
      "learning_rate": 5.974803195025567e-06,
      "loss": 0.0705,
      "mae_dtheta": 0.06881558895111084,
      "mae_dx": 0.028495078906416893,
      "mae_dy": 0.022547198459506035,
      "pose_mae_dtheta": 0.7130364775657654,
      "pose_mae_dx": 0.24343393743038177,
      "pose_mae_dy": 0.22922933101654053,
      "pose_rmse_dtheta": 0.8922222256660461,
      "pose_rmse_dx": 0.3298582136631012,
      "pose_rmse_dy": 0.3858078420162201,
      "pose_rmse_mean": 0.5359628200531006,
      "rmse_dtheta": 0.08120739459991455,
      "rmse_dx": 0.03705120459198952,
      "rmse_dy": 0.02624301053583622,
      "rmse_mean": 0.04816720634698868,
      "rotation_flip": 0.0,
      "sparse_tokens": 1215.0,
      "step": 5319,
      "turn_loss": 0.8048841953277588,
      "turns": 4.0,
      "turns_per_sample": 4.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24716595428359042,
      "grad_norm": 0.7191835641860962,
      "learning_rate": 5.97350631380037e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.010355307720601559,
      "mae_dx": 0.00136961555108428,
      "mae_dy": 0.002522437134757638,
      "pose_mae_dtheta": 0.06400936841964722,
      "pose_mae_dx": 0.02494768239557743,
      "pose_mae_dy": 0.03014046512544155,
      "pose_rmse_dtheta": 0.14284604787826538,
      "pose_rmse_dx": 0.06033237278461456,
      "pose_rmse_dy": 0.06250394135713577,
      "pose_rmse_mean": 0.0885607898235321,
      "rmse_dtheta": 0.021960169076919556,
      "rmse_dx": 0.0039061561692506075,
      "rmse_dy": 0.0050681158900260925,
      "rmse_mean": 0.010311480611562729,
      "rotation_flip": 0.0028500177431851625,
      "sparse_tokens": 32073.0,
      "step": 5320,
      "turn_loss": 0.08292440325021744,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.2472124140494332,
      "grad_norm": 0.41681355237960815,
      "learning_rate": 5.972209364497355e-06,
      "loss": 0.1375,
      "mae_dtheta": 0.030247213318943977,
      "mae_dx": 0.008509878069162369,
      "mae_dy": 0.0035130823962390423,
      "pose_mae_dtheta": 0.22934859991073608,
      "pose_mae_dx": 0.05290979519486427,
      "pose_mae_dy": 0.03775936737656593,
      "pose_rmse_dtheta": 0.4346778690814972,
      "pose_rmse_dx": 0.12522171437740326,
      "pose_rmse_dy": 0.08917026221752167,
      "pose_rmse_mean": 0.21635662019252777,
      "rmse_dtheta": 0.04806201532483101,
      "rmse_dx": 0.018657121807336807,
      "rmse_dy": 0.006577713880687952,
      "rmse_mean": 0.024432284757494926,
      "rotation_flip": 0.006802720949053764,
      "sparse_tokens": 9709.0,
      "step": 5321,
      "turn_loss": 0.230616956949234,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.24725887381527598,
      "grad_norm": 0.5254839658737183,
      "learning_rate": 5.970912347207216e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.032304976135492325,
      "mae_dx": 0.014465506188571453,
      "mae_dy": 0.00508961221203208,
      "pose_mae_dtheta": 0.2512769103050232,
      "pose_mae_dx": 0.13670159876346588,
      "pose_mae_dy": 0.058753132820129395,
      "pose_rmse_dtheta": 0.3935764729976654,
      "pose_rmse_dx": 0.29859861731529236,
      "pose_rmse_dy": 0.12797591090202332,
      "pose_rmse_mean": 0.2733836770057678,
      "rmse_dtheta": 0.04416854307055473,
      "rmse_dx": 0.028584511950612068,
      "rmse_dy": 0.010109939612448215,
      "rmse_mean": 0.02762099914252758,
      "rotation_flip": 0.008379888720810413,
      "sparse_tokens": 13345.0,
      "step": 5322,
      "turn_loss": 0.30890506505966187,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.24730533358111875,
      "grad_norm": 0.8277471661567688,
      "learning_rate": 5.9696152620206575e-06,
      "loss": 0.1779,
      "mae_dtheta": 0.012945462018251419,
      "mae_dx": 0.002395711140707135,
      "mae_dy": 0.0028611640445888042,
      "pose_mae_dtheta": 0.08795294165611267,
      "pose_mae_dx": 0.025731706991791725,
      "pose_mae_dy": 0.02943612076342106,
      "pose_rmse_dtheta": 0.1900274008512497,
      "pose_rmse_dx": 0.05654842033982277,
      "pose_rmse_dy": 0.05932837724685669,
      "pose_rmse_mean": 0.10196807235479355,
      "rmse_dtheta": 0.024711959064006805,
      "rmse_dx": 0.006687529385089874,
      "rmse_dy": 0.005559575743973255,
      "rmse_mean": 0.012319687753915787,
      "rotation_flip": 0.0034916200675070286,
      "sparse_tokens": 32153.0,
      "step": 5323,
      "turn_loss": 0.09968043863773346,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24735179334696153,
      "grad_norm": 0.6363375782966614,
      "learning_rate": 5.968318109028381e-06,
      "loss": 0.1423,
      "mae_dtheta": 0.014281000941991806,
      "mae_dx": 0.002183519769459963,
      "mae_dy": 0.003867125604301691,
      "pose_mae_dtheta": 0.10042697936296463,
      "pose_mae_dx": 0.034429144114255905,
      "pose_mae_dy": 0.04676701873540878,
      "pose_rmse_dtheta": 0.17607146501541138,
      "pose_rmse_dx": 0.07372725754976273,
      "pose_rmse_dy": 0.09770240634679794,
      "pose_rmse_mean": 0.11583371460437775,
      "rmse_dtheta": 0.023656971752643585,
      "rmse_dx": 0.005384158808737993,
      "rmse_dy": 0.007412424311041832,
      "rmse_mean": 0.012151184491813183,
      "rotation_flip": 0.00623359577730298,
      "sparse_tokens": 32121.0,
      "step": 5324,
      "turn_loss": 0.1256941556930542,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.2473982531128043,
      "grad_norm": 0.6362143158912659,
      "learning_rate": 5.9670208883211e-06,
      "loss": 0.1653,
      "mae_dtheta": 0.03768208622932434,
      "mae_dx": 0.014370799995958805,
      "mae_dy": 0.006460173055529594,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6362141966819763,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 149.0942840576172,
      "model/head/act_norm_mean": 108.58329679528062,
      "model/head/act_norm_min": 67.80198669433594,
      "model/head/act_over_embed": 74.6194581305578,
      "model/head/grad_frac": 0.10609117150306702,
      "model/head/grad_norm": 0.06749670952558517,
      "model/head/grad_zero_frac": 0.00016847130609676242,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6954520089285714,
      "model/head/update_ratio": 0.0011550609488040209,
      "model/head/weight_delta": 8.512956619262695,
      "model/head/weight_delta_rel": 0.14934247732162476,
      "model/head/weight_norm": 58.43562698364258,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42049333453178406,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42049333453178406,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42049333453178406,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28896695621086393,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05809977650642395,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03696390241384506,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011953336652368307,
      "model/modality_embedder.encoders.pose/weight_delta": 2.7881643772125244,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09109801799058914,
      "model/modality_embedder.encoders.pose/weight_norm": 30.92350196838379,
      "model/modality_embedder/grad_frac": 0.05809977650642395,
      "model/modality_embedder/grad_norm": 0.03696390241384506,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0011953336652368307,
      "model/modality_embedder/weight_delta": 2.7881643772125244,
      "model/modality_embedder/weight_delta_rel": 0.09109801799058914,
      "model/modality_embedder/weight_norm": 30.92350196838379,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.16389465332031,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.450543610301263,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.280438423156738,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.115433116447335,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10142230987548828,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06452631205320358,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0023188346531242132,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.120239019393921,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07726278901100159,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.827043533325195,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.67671966552734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.265222606899904,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.759854316711426,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.675288150054854,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10854566097259521,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06905829161405563,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0023370173294097185,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.6876578330993652,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09310256689786911,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.54975700378418,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.3347396850586,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.896863358438612,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.92427921295166,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.79656695017364,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11227262765169144,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07142943888902664,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0023413964081555605,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.8932132720947266,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09714868664741516,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.50719451904297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 78.8514175415039,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.826325619533527,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.87378215789795,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.122511479908358,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11623432487249374,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07394992560148239,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0024831516202539206,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.4707376956939697,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08443809300661087,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.780672073364258,
      "model/normalizer/grad_frac": 0.460922509431839,
      "model/normalizer/grad_norm": 0.29324543476104736,
      "model/normalizer/grad_zero_frac": 0.00012880949361715466,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0037398661952465773,
      "model/normalizer/weight_delta": 5.237430095672607,
      "model/normalizer/weight_delta_rel": 0.06745506823062897,
      "model/normalizer/weight_norm": 78.41067504882812,
      "pose_mae_dtheta": 0.2953544557094574,
      "pose_mae_dx": 0.10596999526023865,
      "pose_mae_dy": 0.09731031954288483,
      "pose_rmse_dtheta": 0.5027151703834534,
      "pose_rmse_dx": 0.21338924765586853,
      "pose_rmse_dy": 0.24714942276477814,
      "pose_rmse_mean": 0.3210846185684204,
      "rmse_dtheta": 0.054386790841817856,
      "rmse_dx": 0.02691040188074112,
      "rmse_dy": 0.012923259288072586,
      "rmse_mean": 0.031406816095113754,
      "rotation_flip": 0.01683937758207321,
      "sparse_tokens": 11891.0,
      "step": 5325,
      "turn_loss": 0.27488842606544495,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.24744471287864708,
      "grad_norm": 0.5163867473602295,
      "learning_rate": 5.965723599989529e-06,
      "loss": 0.1272,
      "mae_dtheta": 0.02847120352089405,
      "mae_dx": 0.012711179442703724,
      "mae_dy": 0.007203669287264347,
      "pose_mae_dtheta": 0.22783252596855164,
      "pose_mae_dx": 0.1089792251586914,
      "pose_mae_dy": 0.07670281827449799,
      "pose_rmse_dtheta": 0.4435378313064575,
      "pose_rmse_dx": 0.24060852825641632,
      "pose_rmse_dy": 0.1912720799446106,
      "pose_rmse_mean": 0.291806161403656,
      "rmse_dtheta": 0.047573257237672806,
      "rmse_dx": 0.024937376379966736,
      "rmse_dy": 0.018405942246317863,
      "rmse_mean": 0.0303055252879858,
      "rotation_flip": 0.013636363670229912,
      "sparse_tokens": 21110.0,
      "step": 5326,
      "turn_loss": 0.26862964034080505,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24749117264448986,
      "grad_norm": 0.6085333824157715,
      "learning_rate": 5.964426244124389e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.01462483685463667,
      "mae_dx": 0.002874526660889387,
      "mae_dy": 0.003657666267827153,
      "pose_mae_dtheta": 0.09647715836763382,
      "pose_mae_dx": 0.03896393999457359,
      "pose_mae_dy": 0.042221732437610626,
      "pose_rmse_dtheta": 0.19704727828502655,
      "pose_rmse_dx": 0.08826404809951782,
      "pose_rmse_dy": 0.08734327554702759,
      "pose_rmse_mean": 0.12421821057796478,
      "rmse_dtheta": 0.026977580040693283,
      "rmse_dx": 0.008404770866036415,
      "rmse_dy": 0.006757567636668682,
      "rmse_mean": 0.014046641066670418,
      "rotation_flip": 0.0021192855201661587,
      "sparse_tokens": 32121.0,
      "step": 5327,
      "turn_loss": 0.10972127318382263,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.24753763241033266,
      "grad_norm": 0.43489161133766174,
      "learning_rate": 5.963128820816406e-06,
      "loss": 0.0557,
      "mae_dtheta": 0.009092639200389385,
      "mae_dx": 0.0016826894134283066,
      "mae_dy": 0.0014730028342455626,
      "pose_mae_dtheta": 0.06586257368326187,
      "pose_mae_dx": 0.01383381150662899,
      "pose_mae_dy": 0.01630510576069355,
      "pose_rmse_dtheta": 0.22065597772598267,
      "pose_rmse_dx": 0.04386364296078682,
      "pose_rmse_dy": 0.04610247164964676,
      "pose_rmse_mean": 0.10354070365428925,
      "rmse_dtheta": 0.026727138087153435,
      "rmse_dx": 0.006159669253975153,
      "rmse_dy": 0.005691105034202337,
      "rmse_mean": 0.012859303504228592,
      "rotation_flip": 0.003094378625974059,
      "sparse_tokens": 32153.0,
      "step": 5328,
      "turn_loss": 0.056121211498975754,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.24758409217617544,
      "grad_norm": 0.3697551488876343,
      "learning_rate": 5.961831330156306e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.010305333882570267,
      "mae_dx": 0.0016539230709895492,
      "mae_dy": 0.0021809793543070555,
      "pose_mae_dtheta": 0.06761401146650314,
      "pose_mae_dx": 0.020092396065592766,
      "pose_mae_dy": 0.026538589969277382,
      "pose_rmse_dtheta": 0.16192615032196045,
      "pose_rmse_dx": 0.04804260656237602,
      "pose_rmse_dy": 0.06795719265937805,
      "pose_rmse_mean": 0.09264199435710907,
      "rmse_dtheta": 0.022304128855466843,
      "rmse_dx": 0.004922759253531694,
      "rmse_dy": 0.004723700694739819,
      "rmse_mean": 0.01065019704401493,
      "rotation_flip": 0.0076489532366395,
      "sparse_tokens": 32105.0,
      "step": 5329,
      "turn_loss": 0.07593598961830139,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.24763055194201822,
      "grad_norm": 0.4756081998348236,
      "learning_rate": 5.960533772234825e-06,
      "loss": 0.1376,
      "mae_dtheta": 0.007887900806963444,
      "mae_dx": 0.0018356955843046308,
      "mae_dy": 0.0015446774195879698,
      "pose_mae_dtheta": 0.05851234123110771,
      "pose_mae_dx": 0.01664827950298786,
      "pose_mae_dy": 0.016923021525144577,
      "pose_rmse_dtheta": 0.1858292669057846,
      "pose_rmse_dx": 0.05148779973387718,
      "pose_rmse_dy": 0.04264827072620392,
      "pose_rmse_mean": 0.0933217853307724,
      "rmse_dtheta": 0.022567449137568474,
      "rmse_dx": 0.005600073840469122,
      "rmse_dy": 0.004978482145816088,
      "rmse_mean": 0.011048668995499611,
      "rotation_flip": 0.0030120480805635452,
      "sparse_tokens": 32185.0,
      "step": 5330,
      "turn_loss": 0.06095774471759796,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.247677011707861,
      "grad_norm": 1.2304768562316895,
      "learning_rate": 5.959236147142701e-06,
      "loss": 0.29,
      "mae_dtheta": 0.03780951723456383,
      "mae_dx": 0.011437148787081242,
      "mae_dy": 0.0066388570703566074,
      "pose_mae_dtheta": 0.2796529531478882,
      "pose_mae_dx": 0.0832425132393837,
      "pose_mae_dy": 0.07983636856079102,
      "pose_rmse_dtheta": 0.48680379986763,
      "pose_rmse_dx": 0.19446943700313568,
      "pose_rmse_dy": 0.208291158080101,
      "pose_rmse_mean": 0.29652148485183716,
      "rmse_dtheta": 0.05664655193686485,
      "rmse_dx": 0.023009125143289566,
      "rmse_dy": 0.016763830557465553,
      "rmse_mean": 0.03213983774185181,
      "rotation_flip": 0.010588235221803188,
      "sparse_tokens": 14727.0,
      "step": 5331,
      "turn_loss": 0.3506939709186554,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 23941.0,
      "epoch": 0.24772347147370377,
      "grad_norm": 0.6166071891784668,
      "learning_rate": 5.957938454970678e-06,
      "loss": 0.1735,
      "mae_dtheta": 0.03130310773849487,
      "mae_dx": 0.013018910773098469,
      "mae_dy": 0.005006877705454826,
      "pose_mae_dtheta": 0.24330617487430573,
      "pose_mae_dx": 0.101401686668396,
      "pose_mae_dy": 0.04909171164035797,
      "pose_rmse_dtheta": 0.46219468116760254,
      "pose_rmse_dx": 0.2306835949420929,
      "pose_rmse_dy": 0.1490228921175003,
      "pose_rmse_mean": 0.28063371777534485,
      "rmse_dtheta": 0.04974149540066719,
      "rmse_dx": 0.026115402579307556,
      "rmse_dy": 0.01158905029296875,
      "rmse_mean": 0.0291486494243145,
      "rotation_flip": 0.012400354258716106,
      "sparse_tokens": 19378.0,
      "step": 5332,
      "turn_loss": 0.2429453581571579,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.24776993123954655,
      "grad_norm": 0.6010175347328186,
      "learning_rate": 5.956640695809505e-06,
      "loss": 0.1258,
      "mae_dtheta": 0.009349092841148376,
      "mae_dx": 0.001193877775222063,
      "mae_dy": 0.0021571298129856586,
      "pose_mae_dtheta": 0.059703316539525986,
      "pose_mae_dx": 0.020741622895002365,
      "pose_mae_dy": 0.032819025218486786,
      "pose_rmse_dtheta": 0.11412476003170013,
      "pose_rmse_dx": 0.05432845652103424,
      "pose_rmse_dy": 0.07299376279115677,
      "pose_rmse_mean": 0.08048232644796371,
      "rmse_dtheta": 0.018015671521425247,
      "rmse_dx": 0.0035211360082030296,
      "rmse_dy": 0.004627475049346685,
      "rmse_mean": 0.008721427991986275,
      "rotation_flip": 0.004562737420201302,
      "sparse_tokens": 32041.0,
      "step": 5333,
      "turn_loss": 0.07532978802919388,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.24781639100538932,
      "grad_norm": 0.5472562313079834,
      "learning_rate": 5.955342869749935e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.03468199446797371,
      "mae_dx": 0.011296549811959267,
      "mae_dy": 0.005079807713627815,
      "pose_mae_dtheta": 0.23913098871707916,
      "pose_mae_dx": 0.10359995812177658,
      "pose_mae_dy": 0.06366753578186035,
      "pose_rmse_dtheta": 0.4535522162914276,
      "pose_rmse_dx": 0.22910766303539276,
      "pose_rmse_dy": 0.131288081407547,
      "pose_rmse_mean": 0.2713159918785095,
      "rmse_dtheta": 0.053413376212120056,
      "rmse_dx": 0.02330363355576992,
      "rmse_dy": 0.00956730730831623,
      "rmse_mean": 0.02876143902540207,
      "rotation_flip": 0.013186813332140446,
      "sparse_tokens": 15658.0,
      "step": 5334,
      "turn_loss": 0.24464169144630432,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.2478628507712321,
      "grad_norm": 0.43159863352775574,
      "learning_rate": 5.954044976882725e-06,
      "loss": 0.0864,
      "mae_dtheta": 0.029306761920452118,
      "mae_dx": 0.010552626103162766,
      "mae_dy": 0.0035021526273339987,
      "pose_mae_dtheta": 0.21187806129455566,
      "pose_mae_dx": 0.08449888974428177,
      "pose_mae_dy": 0.056584250181913376,
      "pose_rmse_dtheta": 0.3782113492488861,
      "pose_rmse_dx": 0.21852637827396393,
      "pose_rmse_dy": 0.12141739577054977,
      "pose_rmse_mean": 0.23938505351543427,
      "rmse_dtheta": 0.04578747600317001,
      "rmse_dx": 0.024063415825366974,
      "rmse_dy": 0.006183988880366087,
      "rmse_mean": 0.025344960391521454,
      "rotation_flip": 0.005474452394992113,
      "sparse_tokens": 10175.0,
      "step": 5335,
      "turn_loss": 0.2081894874572754,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2479093105370749,
      "grad_norm": 0.547960638999939,
      "learning_rate": 5.952747017298638e-06,
      "loss": 0.1835,
      "mae_dtheta": 0.007781714666634798,
      "mae_dx": 0.001478985301218927,
      "mae_dy": 0.0018173381686210632,
      "pose_mae_dtheta": 0.04755887761712074,
      "pose_mae_dx": 0.01923448219895363,
      "pose_mae_dy": 0.02298366278409958,
      "pose_rmse_dtheta": 0.1164378896355629,
      "pose_rmse_dx": 0.04178953915834427,
      "pose_rmse_dy": 0.059070341289043427,
      "pose_rmse_mean": 0.07243259251117706,
      "rmse_dtheta": 0.017615118995308876,
      "rmse_dx": 0.004302015528082848,
      "rmse_dy": 0.004078857600688934,
      "rmse_mean": 0.008665330708026886,
      "rotation_flip": 0.003694126382470131,
      "sparse_tokens": 32153.0,
      "step": 5336,
      "turn_loss": 0.060621604323387146,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.24795577030291768,
      "grad_norm": 0.7665276527404785,
      "learning_rate": 5.951448991088441e-06,
      "loss": 0.1813,
      "mae_dtheta": 0.033926282078027725,
      "mae_dx": 0.016398662701249123,
      "mae_dy": 0.00596964918076992,
      "pose_mae_dtheta": 0.2607556879520416,
      "pose_mae_dx": 0.13151852786540985,
      "pose_mae_dy": 0.0952489823102951,
      "pose_rmse_dtheta": 0.4331510066986084,
      "pose_rmse_dx": 0.27270540595054626,
      "pose_rmse_dy": 0.1908542364835739,
      "pose_rmse_mean": 0.29890358448028564,
      "rmse_dtheta": 0.049295347183942795,
      "rmse_dx": 0.030942024663090706,
      "rmse_dy": 0.010030834004282951,
      "rmse_mean": 0.030089404433965683,
      "rotation_flip": 0.013215859420597553,
      "sparse_tokens": 19738.0,
      "step": 5337,
      "turn_loss": 0.28107506036758423,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24800223006876046,
      "grad_norm": 0.7217313647270203,
      "learning_rate": 5.950150898342905e-06,
      "loss": 0.0895,
      "mae_dtheta": 0.00718429870903492,
      "mae_dx": 0.001443004934117198,
      "mae_dy": 0.0010127195855602622,
      "pose_mae_dtheta": 0.04838331416249275,
      "pose_mae_dx": 0.015369963832199574,
      "pose_mae_dy": 0.013592252507805824,
      "pose_rmse_dtheta": 0.16241663694381714,
      "pose_rmse_dx": 0.04134390875697136,
      "pose_rmse_dy": 0.036341119557619095,
      "pose_rmse_mean": 0.08003389090299606,
      "rmse_dtheta": 0.022513985633850098,
      "rmse_dx": 0.004240657668560743,
      "rmse_dy": 0.002478125039488077,
      "rmse_mean": 0.009744256734848022,
      "rotation_flip": 0.004464285913854837,
      "sparse_tokens": 32121.0,
      "step": 5338,
      "turn_loss": 0.05343297868967056,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.24804868983460324,
      "grad_norm": 0.6018538475036621,
      "learning_rate": 5.948852739152806e-06,
      "loss": 0.1381,
      "mae_dtheta": 0.010629592463374138,
      "mae_dx": 0.0025082770735025406,
      "mae_dy": 0.004030879121273756,
      "pose_mae_dtheta": 0.0758289247751236,
      "pose_mae_dx": 0.036509670317173004,
      "pose_mae_dy": 0.034071970731019974,
      "pose_rmse_dtheta": 0.18400472402572632,
      "pose_rmse_dx": 0.09936587512493134,
      "pose_rmse_dy": 0.09437496960163116,
      "pose_rmse_mean": 0.12591519951820374,
      "rmse_dtheta": 0.021416638046503067,
      "rmse_dx": 0.006523138377815485,
      "rmse_dy": 0.009657997637987137,
      "rmse_mean": 0.012532591819763184,
      "rotation_flip": 0.005281690042465925,
      "sparse_tokens": 32089.0,
      "step": 5339,
      "turn_loss": 0.10874206572771072,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.248095149600446,
      "grad_norm": 0.5848705768585205,
      "learning_rate": 5.947554513608926e-06,
      "loss": 0.1605,
      "mae_dtheta": 0.029083430767059326,
      "mae_dx": 0.012907478958368301,
      "mae_dy": 0.004487363155931234,
      "pose_mae_dtheta": 0.21902534365653992,
      "pose_mae_dx": 0.07820454984903336,
      "pose_mae_dy": 0.06995067745447159,
      "pose_rmse_dtheta": 0.4598507583141327,
      "pose_rmse_dx": 0.1675419807434082,
      "pose_rmse_dy": 0.15751352906227112,
      "pose_rmse_mean": 0.261635422706604,
      "rmse_dtheta": 0.04805423319339752,
      "rmse_dx": 0.025644773617386818,
      "rmse_dy": 0.008408037945628166,
      "rmse_mean": 0.02736901491880417,
      "rotation_flip": 0.0049019609577953815,
      "sparse_tokens": 4018.0,
      "step": 5340,
      "turn_loss": 0.19574323296546936,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2481416093662888,
      "grad_norm": 0.5438265800476074,
      "learning_rate": 5.946256221802052e-06,
      "loss": 0.1422,
      "mae_dtheta": 0.01576116681098938,
      "mae_dx": 0.006831394508481026,
      "mae_dy": 0.006755574606359005,
      "pose_mae_dtheta": 0.12083619087934494,
      "pose_mae_dx": 0.0752386525273323,
      "pose_mae_dy": 0.052552711218595505,
      "pose_rmse_dtheta": 0.279548317193985,
      "pose_rmse_dx": 0.1953030675649643,
      "pose_rmse_dy": 0.12945152819156647,
      "pose_rmse_mean": 0.20143429934978485,
      "rmse_dtheta": 0.03079037368297577,
      "rmse_dx": 0.016334611922502518,
      "rmse_dy": 0.014113477431237698,
      "rmse_mean": 0.02041282132267952,
      "rotation_flip": 0.008015389554202557,
      "sparse_tokens": 32137.0,
      "step": 5341,
      "turn_loss": 0.19411101937294006,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.24818806913213157,
      "grad_norm": 0.5561334490776062,
      "learning_rate": 5.944957863822971e-06,
      "loss": 0.126,
      "mae_dtheta": 0.0399663969874382,
      "mae_dx": 0.014304584823548794,
      "mae_dy": 0.011034110561013222,
      "pose_mae_dtheta": 0.37012454867362976,
      "pose_mae_dx": 0.1421385258436203,
      "pose_mae_dy": 0.12638790905475616,
      "pose_rmse_dtheta": 0.6010969281196594,
      "pose_rmse_dx": 0.27953633666038513,
      "pose_rmse_dy": 0.2555786669254303,
      "pose_rmse_mean": 0.37873730063438416,
      "rmse_dtheta": 0.057482149451971054,
      "rmse_dx": 0.02671050652861595,
      "rmse_dy": 0.020520348101854324,
      "rmse_mean": 0.03490433841943741,
      "rotation_flip": 0.006226649973541498,
      "sparse_tokens": 14610.0,
      "step": 5342,
      "turn_loss": 0.38909849524497986,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 1986.0,
      "epoch": 0.24823452889797434,
      "grad_norm": 0.4063301086425781,
      "learning_rate": 5.94365943976248e-06,
      "loss": 0.0816,
      "mae_dtheta": 0.029667723923921585,
      "mae_dx": 0.006243858020752668,
      "mae_dy": 0.011731429025530815,
      "pose_mae_dtheta": 0.24075375497341156,
      "pose_mae_dx": 0.0895586684346199,
      "pose_mae_dy": 0.18340018391609192,
      "pose_rmse_dtheta": 0.29799047112464905,
      "pose_rmse_dx": 0.13978104293346405,
      "pose_rmse_dy": 0.300008088350296,
      "pose_rmse_mean": 0.24592654407024384,
      "rmse_dtheta": 0.03614884987473488,
      "rmse_dx": 0.014103082939982414,
      "rmse_dy": 0.015137850306928158,
      "rmse_mean": 0.02179659530520439,
      "rotation_flip": 0.0,
      "sparse_tokens": 1556.0,
      "step": 5343,
      "turn_loss": 0.23394262790679932,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24828098866381715,
      "grad_norm": 0.47790592908859253,
      "learning_rate": 5.942360949711376e-06,
      "loss": 0.1055,
      "mae_dtheta": 0.011816881597042084,
      "mae_dx": 0.0034220765810459852,
      "mae_dy": 0.001496874843724072,
      "pose_mae_dtheta": 0.08041641861200333,
      "pose_mae_dx": 0.03476741164922714,
      "pose_mae_dy": 0.021537406370043755,
      "pose_rmse_dtheta": 0.22551685571670532,
      "pose_rmse_dx": 0.12123192101716995,
      "pose_rmse_dy": 0.0630880817770958,
      "pose_rmse_mean": 0.13661229610443115,
      "rmse_dtheta": 0.028020797297358513,
      "rmse_dx": 0.012265228666365147,
      "rmse_dy": 0.0034649295266717672,
      "rmse_mean": 0.014583652839064598,
      "rotation_flip": 0.002718868898227811,
      "sparse_tokens": 32073.0,
      "step": 5344,
      "turn_loss": 0.08174609392881393,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.24832744842965992,
      "grad_norm": 0.6190225481987,
      "learning_rate": 5.941062393760467e-06,
      "loss": 0.1818,
      "mae_dtheta": 0.013871883042156696,
      "mae_dx": 0.001793388742953539,
      "mae_dy": 0.0028878303710371256,
      "pose_mae_dtheta": 0.09146874397993088,
      "pose_mae_dx": 0.027888985350728035,
      "pose_mae_dy": 0.031291745603084564,
      "pose_rmse_dtheta": 0.23705437779426575,
      "pose_rmse_dx": 0.08490730077028275,
      "pose_rmse_dy": 0.07859541475772858,
      "pose_rmse_mean": 0.1335190385580063,
      "rmse_dtheta": 0.028754672035574913,
      "rmse_dx": 0.005578097887337208,
      "rmse_dy": 0.006419753190129995,
      "rmse_mean": 0.01358417421579361,
      "rotation_flip": 0.0034626037813723087,
      "sparse_tokens": 32089.0,
      "step": 5345,
      "turn_loss": 0.11302737891674042,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.2483739081955027,
      "grad_norm": 0.5929751396179199,
      "learning_rate": 5.93976377200056e-06,
      "loss": 0.1268,
      "mae_dtheta": 0.03291919082403183,
      "mae_dx": 0.01239051390439272,
      "mae_dy": 0.007637395057827234,
      "pose_mae_dtheta": 0.2475607544183731,
      "pose_mae_dx": 0.0990089476108551,
      "pose_mae_dy": 0.0867438092827797,
      "pose_rmse_dtheta": 0.41578352451324463,
      "pose_rmse_dx": 0.2252511829137802,
      "pose_rmse_dy": 0.19602033495903015,
      "pose_rmse_mean": 0.279018372297287,
      "rmse_dtheta": 0.04840841889381409,
      "rmse_dx": 0.025219665840268135,
      "rmse_dy": 0.014465667307376862,
      "rmse_mean": 0.029364584013819695,
      "rotation_flip": 0.027027027681469917,
      "sparse_tokens": 21003.0,
      "step": 5346,
      "turn_loss": 0.28450194001197815,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24842036796134548,
      "grad_norm": 0.4581526815891266,
      "learning_rate": 5.938465084522468e-06,
      "loss": 0.114,
      "mae_dtheta": 0.011197875253856182,
      "mae_dx": 0.002249313285574317,
      "mae_dy": 0.0022622316610068083,
      "pose_mae_dtheta": 0.08073892444372177,
      "pose_mae_dx": 0.024731842800974846,
      "pose_mae_dy": 0.0261904988437891,
      "pose_rmse_dtheta": 0.24902069568634033,
      "pose_rmse_dx": 0.07866833359003067,
      "pose_rmse_dy": 0.06704667955636978,
      "pose_rmse_mean": 0.13157856464385986,
      "rmse_dtheta": 0.02690770849585533,
      "rmse_dx": 0.00808559451252222,
      "rmse_dy": 0.0056116762571036816,
      "rmse_mean": 0.013534992933273315,
      "rotation_flip": 0.0041981530375778675,
      "sparse_tokens": 32121.0,
      "step": 5347,
      "turn_loss": 0.091131791472435,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.24846682772718826,
      "grad_norm": 0.40565958619117737,
      "learning_rate": 5.937166331417008e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.0117241982370615,
      "mae_dx": 0.0019064215011894703,
      "mae_dy": 0.003333296859636903,
      "pose_mae_dtheta": 0.07426567375659943,
      "pose_mae_dx": 0.024532712996006012,
      "pose_mae_dy": 0.03522777184844017,
      "pose_rmse_dtheta": 0.15234556794166565,
      "pose_rmse_dx": 0.058343689888715744,
      "pose_rmse_dy": 0.0767119899392128,
      "pose_rmse_mean": 0.09580042213201523,
      "rmse_dtheta": 0.022406606003642082,
      "rmse_dx": 0.0054690041579306126,
      "rmse_dy": 0.007402482442557812,
      "rmse_mean": 0.011759364977478981,
      "rotation_flip": 0.0024271844886243343,
      "sparse_tokens": 32137.0,
      "step": 5348,
      "turn_loss": 0.1092219427227974,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.24851328749303103,
      "grad_norm": 0.4940204620361328,
      "learning_rate": 5.935867512775004e-06,
      "loss": 0.146,
      "mae_dtheta": 0.034132324159145355,
      "mae_dx": 0.014538283459842205,
      "mae_dy": 0.0069558206014335155,
      "pose_mae_dtheta": 0.2694818079471588,
      "pose_mae_dx": 0.11388801783323288,
      "pose_mae_dy": 0.0876607596874237,
      "pose_rmse_dtheta": 0.46490901708602905,
      "pose_rmse_dx": 0.24202775955200195,
      "pose_rmse_dy": 0.1724356859922409,
      "pose_rmse_mean": 0.29312416911125183,
      "rmse_dtheta": 0.049625277519226074,
      "rmse_dx": 0.027929898351430893,
      "rmse_dy": 0.011752701364457607,
      "rmse_mean": 0.02976929396390915,
      "rotation_flip": 0.021252796053886414,
      "sparse_tokens": 16642.0,
      "step": 5349,
      "turn_loss": 0.2947603762149811,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2485597472588738,
      "grad_norm": 0.33035558462142944,
      "learning_rate": 5.9345686286872826e-06,
      "loss": 0.085,
      "mae_dtheta": 0.008801572024822235,
      "mae_dx": 0.0011476780055090785,
      "mae_dy": 0.0020630008075386286,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.33035561442375183,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 163.95960998535156,
      "model/head/act_norm_mean": 119.53967408459596,
      "model/head/act_norm_min": 73.702880859375,
      "model/head/act_over_embed": 82.14878317899559,
      "model/head/grad_frac": 0.11579305678606033,
      "model/head/grad_norm": 0.03825288638472557,
      "model/head/grad_zero_frac": 0.00013484050577972084,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6990806502525253,
      "model/head/update_ratio": 0.0006545752985402942,
      "model/head/weight_delta": 8.53156566619873,
      "model/head/weight_delta_rel": 0.14966893196105957,
      "model/head/weight_norm": 58.43924331665039,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4205057621002197,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4204127799331872,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4203376770019531,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2889115983365442,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10715793073177338,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03540022298693657,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5428980486425339,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011447269935160875,
      "model/modality_embedder.encoders.pose/weight_delta": 2.796663284301758,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09137570858001709,
      "model/modality_embedder.encoders.pose/weight_norm": 30.924598693847656,
      "model/modality_embedder/grad_frac": 0.10715793073177338,
      "model/modality_embedder/grad_norm": 0.03540022298693657,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5428980486425339,
      "model/modality_embedder/update_ratio": 0.0011447269935160875,
      "model/modality_embedder/weight_delta": 2.796663284301758,
      "model/modality_embedder/weight_delta_rel": 0.09137570858001709,
      "model/modality_embedder/weight_norm": 30.924598693847656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.14479064941406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.51430224867725,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.059147834777832,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.846458011804593,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08208775520324707,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.027118150144815445,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009744670242071152,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.1274402141571045,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07752520591020584,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.828699111938477,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.47816467285156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.548295454545453,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.339603424072266,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.557027823274133,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08416852355003357,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.027805544435977936,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009408922051079571,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.6954009532928467,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09337079524993896,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.552316665649414,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.09983825683594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.457110790444123,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.61254596710205,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.86878359271443,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09322481602430344,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030797341838479042,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010094379540532827,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.9014790058135986,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09742623567581177,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.509395599365234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.63260650634766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.20658469616803,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.79297161102295,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.071038439560656,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10959958285093307,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03620683774352074,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012156958691775799,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.477884531021118,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08468233793973923,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.78281021118164,
      "model/normalizer/grad_frac": 0.4069283902645111,
      "model/normalizer/grad_norm": 0.13443107903003693,
      "model/normalizer/grad_zero_frac": 0.00016189816233236343,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017143924487754703,
      "model/normalizer/weight_delta": 5.252875804901123,
      "model/normalizer/weight_delta_rel": 0.06765399873256683,
      "model/normalizer/weight_norm": 78.41324615478516,
      "pose_mae_dtheta": 0.058196138590574265,
      "pose_mae_dx": 0.012463511899113655,
      "pose_mae_dy": 0.022351099178195,
      "pose_rmse_dtheta": 0.14601266384124756,
      "pose_rmse_dx": 0.029964638873934746,
      "pose_rmse_dy": 0.05068302899599075,
      "pose_rmse_mean": 0.07555344700813293,
      "rmse_dtheta": 0.01981845125555992,
      "rmse_dx": 0.003357426030561328,
      "rmse_dy": 0.0051505547016859055,
      "rmse_mean": 0.009442144073545933,
      "rotation_flip": 0.002091175178065896,
      "sparse_tokens": 32089.0,
      "step": 5350,
      "turn_loss": 0.08032235503196716,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19742.0,
      "epoch": 0.24860620702471659,
      "grad_norm": 0.5157546997070312,
      "learning_rate": 5.933269679244673e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.03558528795838356,
      "mae_dx": 0.010939148254692554,
      "mae_dy": 0.007037450559437275,
      "pose_mae_dtheta": 0.26634934544563293,
      "pose_mae_dx": 0.10623561590909958,
      "pose_mae_dy": 0.09383250772953033,
      "pose_rmse_dtheta": 0.41361838579177856,
      "pose_rmse_dx": 0.24232932925224304,
      "pose_rmse_dy": 0.1879316121339798,
      "pose_rmse_mean": 0.2812930941581726,
      "rmse_dtheta": 0.0496336966753006,
      "rmse_dx": 0.02386045828461647,
      "rmse_dy": 0.012430260889232159,
      "rmse_mean": 0.0286414697766304,
      "rotation_flip": 0.016376662999391556,
      "sparse_tokens": 15507.0,
      "step": 5351,
      "turn_loss": 0.3312082886695862,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.24865266679055936,
      "grad_norm": 0.554871678352356,
      "learning_rate": 5.931970664538016e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.0402216911315918,
      "mae_dx": 0.012571705505251884,
      "mae_dy": 0.005389099009335041,
      "pose_mae_dtheta": 0.2974070906639099,
      "pose_mae_dx": 0.10438021272420883,
      "pose_mae_dy": 0.06019902229309082,
      "pose_rmse_dtheta": 0.4698212742805481,
      "pose_rmse_dx": 0.2202085703611374,
      "pose_rmse_dy": 0.14495933055877686,
      "pose_rmse_mean": 0.2783297300338745,
      "rmse_dtheta": 0.05664505437016487,
      "rmse_dx": 0.02479940466582775,
      "rmse_dy": 0.012640967965126038,
      "rmse_mean": 0.031361810863018036,
      "rotation_flip": 0.01967673934996128,
      "sparse_tokens": 22001.0,
      "step": 5352,
      "turn_loss": 0.28933754563331604,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24869912655640217,
      "grad_norm": 0.3099546432495117,
      "learning_rate": 5.930671584658151e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.007183076348155737,
      "mae_dx": 0.0011885958956554532,
      "mae_dy": 0.0015698943752795458,
      "pose_mae_dtheta": 0.04713689163327217,
      "pose_mae_dx": 0.01694912277162075,
      "pose_mae_dy": 0.020588181912899017,
      "pose_rmse_dtheta": 0.10806658864021301,
      "pose_rmse_dx": 0.04561365023255348,
      "pose_rmse_dy": 0.05596005916595459,
      "pose_rmse_mean": 0.06988009810447693,
      "rmse_dtheta": 0.016013450920581818,
      "rmse_dx": 0.0035608340986073017,
      "rmse_dy": 0.0034599523060023785,
      "rmse_mean": 0.007678079418838024,
      "rotation_flip": 0.0012244897661730647,
      "sparse_tokens": 32121.0,
      "step": 5353,
      "turn_loss": 0.062365684658288956,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11057.0,
      "epoch": 0.24874558632224494,
      "grad_norm": 0.3916509747505188,
      "learning_rate": 5.9293724396959214e-06,
      "loss": 0.1067,
      "mae_dtheta": 0.028146622702479362,
      "mae_dx": 0.0076017617247998714,
      "mae_dy": 0.002862865338101983,
      "pose_mae_dtheta": 0.2023247927427292,
      "pose_mae_dx": 0.059610649943351746,
      "pose_mae_dy": 0.03600812703371048,
      "pose_rmse_dtheta": 0.3627970516681671,
      "pose_rmse_dx": 0.1453031599521637,
      "pose_rmse_dy": 0.11866864562034607,
      "pose_rmse_mean": 0.20892295241355896,
      "rmse_dtheta": 0.047778308391571045,
      "rmse_dx": 0.017768245190382004,
      "rmse_dy": 0.007913540117442608,
      "rmse_mean": 0.02448669821023941,
      "rotation_flip": 0.016917293891310692,
      "sparse_tokens": 9499.0,
      "step": 5354,
      "turn_loss": 0.15947821736335754,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.24879204608808772,
      "grad_norm": 0.48227447271347046,
      "learning_rate": 5.928073229742178e-06,
      "loss": 0.132,
      "mae_dtheta": 0.008008168078958988,
      "mae_dx": 0.0017337774625048041,
      "mae_dy": 0.0020782812498509884,
      "pose_mae_dtheta": 0.05115675926208496,
      "pose_mae_dx": 0.022360362112522125,
      "pose_mae_dy": 0.019986800849437714,
      "pose_rmse_dtheta": 0.15842527151107788,
      "pose_rmse_dx": 0.0771225318312645,
      "pose_rmse_dy": 0.053188204765319824,
      "pose_rmse_mean": 0.09624534100294113,
      "rmse_dtheta": 0.020767636597156525,
      "rmse_dx": 0.005151985213160515,
      "rmse_dy": 0.006023155525326729,
      "rmse_mean": 0.010647593066096306,
      "rotation_flip": 0.0050682262517511845,
      "sparse_tokens": 32153.0,
      "step": 5355,
      "turn_loss": 0.07864905148744583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2488385058539305,
      "grad_norm": 0.6479347348213196,
      "learning_rate": 5.926773954887777e-06,
      "loss": 0.153,
      "mae_dtheta": 0.011455655097961426,
      "mae_dx": 0.002189645078033209,
      "mae_dy": 0.002601321553811431,
      "pose_mae_dtheta": 0.07461350411176682,
      "pose_mae_dx": 0.022729996591806412,
      "pose_mae_dy": 0.027030929923057556,
      "pose_rmse_dtheta": 0.21705462038516998,
      "pose_rmse_dx": 0.057693082839250565,
      "pose_rmse_dy": 0.05954718217253685,
      "pose_rmse_mean": 0.11143162846565247,
      "rmse_dtheta": 0.026469392701983452,
      "rmse_dx": 0.006779702380299568,
      "rmse_dy": 0.005423075519502163,
      "rmse_mean": 0.012890724465250969,
      "rotation_flip": 0.007299270015209913,
      "sparse_tokens": 32105.0,
      "step": 5356,
      "turn_loss": 0.09899412840604782,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24888496561977327,
      "grad_norm": 0.6404238343238831,
      "learning_rate": 5.925474615223573e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.009303050115704536,
      "mae_dx": 0.0015886498149484396,
      "mae_dy": 0.00212021148763597,
      "pose_mae_dtheta": 0.060070060193538666,
      "pose_mae_dx": 0.01904989406466484,
      "pose_mae_dy": 0.027668045833706856,
      "pose_rmse_dtheta": 0.1133621484041214,
      "pose_rmse_dx": 0.04718397185206413,
      "pose_rmse_dy": 0.059991057962179184,
      "pose_rmse_mean": 0.07351239770650864,
      "rmse_dtheta": 0.017552705481648445,
      "rmse_dx": 0.005504327360540628,
      "rmse_dy": 0.004339874722063541,
      "rmse_mean": 0.00913230236619711,
      "rotation_flip": 0.006761833094060421,
      "sparse_tokens": 32073.0,
      "step": 5357,
      "turn_loss": 0.08320659399032593,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.24893142538561605,
      "grad_norm": 0.41284817457199097,
      "learning_rate": 5.924175210840435e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.02647598460316658,
      "mae_dx": 0.011214189231395721,
      "mae_dy": 0.003592110937461257,
      "pose_mae_dtheta": 0.18719348311424255,
      "pose_mae_dx": 0.09385118633508682,
      "pose_mae_dy": 0.06499222666025162,
      "pose_rmse_dtheta": 0.37173694372177124,
      "pose_rmse_dx": 0.24050207436084747,
      "pose_rmse_dy": 0.12500658631324768,
      "pose_rmse_mean": 0.24574851989746094,
      "rmse_dtheta": 0.0436721108853817,
      "rmse_dx": 0.025399206206202507,
      "rmse_dy": 0.005828965455293655,
      "rmse_mean": 0.024966761469841003,
      "rotation_flip": 0.01490514911711216,
      "sparse_tokens": 15979.0,
      "step": 5358,
      "turn_loss": 0.17340150475502014,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.24897788515145883,
      "grad_norm": 1.0367645025253296,
      "learning_rate": 5.922875741829227e-06,
      "loss": 0.1449,
      "mae_dtheta": 0.034729406237602234,
      "mae_dx": 0.006932392716407776,
      "mae_dy": 0.004037771373987198,
      "pose_mae_dtheta": 0.23270273208618164,
      "pose_mae_dx": 0.05953115224838257,
      "pose_mae_dy": 0.03853447735309601,
      "pose_rmse_dtheta": 0.4435301423072815,
      "pose_rmse_dx": 0.15696783363819122,
      "pose_rmse_dy": 0.07483825087547302,
      "pose_rmse_mean": 0.22511208057403564,
      "rmse_dtheta": 0.05598466470837593,
      "rmse_dx": 0.01780015416443348,
      "rmse_dy": 0.009470053017139435,
      "rmse_mean": 0.027751624584197998,
      "rotation_flip": 0.011627906933426857,
      "sparse_tokens": 5263.0,
      "step": 5359,
      "turn_loss": 0.24272465705871582,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.2490243449173016,
      "grad_norm": 0.47883903980255127,
      "learning_rate": 5.921576208280825e-06,
      "loss": 0.1204,
      "mae_dtheta": 0.02723272331058979,
      "mae_dx": 0.009808608330786228,
      "mae_dy": 0.003573960391804576,
      "pose_mae_dtheta": 0.19672046601772308,
      "pose_mae_dx": 0.07619345188140869,
      "pose_mae_dy": 0.03504663333296776,
      "pose_rmse_dtheta": 0.3498895764350891,
      "pose_rmse_dx": 0.15435650944709778,
      "pose_rmse_dy": 0.0725582018494606,
      "pose_rmse_mean": 0.19226811826229095,
      "rmse_dtheta": 0.042499370872974396,
      "rmse_dx": 0.019357210025191307,
      "rmse_dy": 0.006853608414530754,
      "rmse_mean": 0.02290339767932892,
      "rotation_flip": 0.012962962500751019,
      "sparse_tokens": 8994.0,
      "step": 5360,
      "turn_loss": 0.2415160834789276,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.2490708046831444,
      "grad_norm": 0.6921247243881226,
      "learning_rate": 5.920276610286102e-06,
      "loss": 0.1542,
      "mae_dtheta": 0.03647935390472412,
      "mae_dx": 0.012674089521169662,
      "mae_dy": 0.00404596421867609,
      "pose_mae_dtheta": 0.2944507598876953,
      "pose_mae_dx": 0.10838667303323746,
      "pose_mae_dy": 0.04444475099444389,
      "pose_rmse_dtheta": 0.5401623845100403,
      "pose_rmse_dx": 0.2462497502565384,
      "pose_rmse_dy": 0.1158747524023056,
      "pose_rmse_mean": 0.3007622957229614,
      "rmse_dtheta": 0.0566779226064682,
      "rmse_dx": 0.025751858949661255,
      "rmse_dy": 0.009786269627511501,
      "rmse_mean": 0.03073868528008461,
      "rotation_flip": 0.011702127754688263,
      "sparse_tokens": 14705.0,
      "step": 5361,
      "turn_loss": 0.2553223669528961,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.24911726444898719,
      "grad_norm": 0.9454758167266846,
      "learning_rate": 5.9189769479359425e-06,
      "loss": 0.1592,
      "mae_dtheta": 0.038630351424217224,
      "mae_dx": 0.015557649545371532,
      "mae_dy": 0.007391376420855522,
      "pose_mae_dtheta": 0.30373457074165344,
      "pose_mae_dx": 0.12277547270059586,
      "pose_mae_dy": 0.05587834492325783,
      "pose_rmse_dtheta": 0.5103853940963745,
      "pose_rmse_dx": 0.2667960226535797,
      "pose_rmse_dy": 0.11545027792453766,
      "pose_rmse_mean": 0.29754388332366943,
      "rmse_dtheta": 0.056659914553165436,
      "rmse_dx": 0.030168093740940094,
      "rmse_dy": 0.015091734938323498,
      "rmse_mean": 0.033973246812820435,
      "rotation_flip": 0.005253940355032682,
      "sparse_tokens": 10071.0,
      "step": 5362,
      "turn_loss": 0.42772823572158813,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.24916372421482996,
      "grad_norm": 0.43723827600479126,
      "learning_rate": 5.917677221321232e-06,
      "loss": 0.1405,
      "mae_dtheta": 0.036555930972099304,
      "mae_dx": 0.010771027766168118,
      "mae_dy": 0.004072518553584814,
      "pose_mae_dtheta": 0.28524860739707947,
      "pose_mae_dx": 0.08367576450109482,
      "pose_mae_dy": 0.04688361659646034,
      "pose_rmse_dtheta": 0.504114031791687,
      "pose_rmse_dx": 0.18188072741031647,
      "pose_rmse_dy": 0.10914255678653717,
      "pose_rmse_mean": 0.26504576206207275,
      "rmse_dtheta": 0.05505348742008209,
      "rmse_dx": 0.021823203191161156,
      "rmse_dy": 0.008454980328679085,
      "rmse_mean": 0.028443891555070877,
      "rotation_flip": 0.009066183120012283,
      "sparse_tokens": 18234.0,
      "step": 5363,
      "turn_loss": 0.2919149100780487,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.24921018398067274,
      "grad_norm": 0.5854348540306091,
      "learning_rate": 5.91637743053286e-06,
      "loss": 0.1902,
      "mae_dtheta": 0.034934695810079575,
      "mae_dx": 0.0112466961145401,
      "mae_dy": 0.007646090351045132,
      "pose_mae_dtheta": 0.2628304958343506,
      "pose_mae_dx": 0.09042445570230484,
      "pose_mae_dy": 0.079681895673275,
      "pose_rmse_dtheta": 0.4763813018798828,
      "pose_rmse_dx": 0.20425575971603394,
      "pose_rmse_dy": 0.19128888845443726,
      "pose_rmse_mean": 0.29064199328422546,
      "rmse_dtheta": 0.054524097591638565,
      "rmse_dx": 0.022990383207798004,
      "rmse_dy": 0.01732807792723179,
      "rmse_mean": 0.031614188104867935,
      "rotation_flip": 0.014542344026267529,
      "sparse_tokens": 20890.0,
      "step": 5364,
      "turn_loss": 0.39968231320381165,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.24925664374651552,
      "grad_norm": 0.5558645725250244,
      "learning_rate": 5.915077575661723e-06,
      "loss": 0.0649,
      "mae_dtheta": 0.021683353930711746,
      "mae_dx": 0.0052473824471235275,
      "mae_dy": 0.003700406989082694,
      "pose_mae_dtheta": 0.17603227496147156,
      "pose_mae_dx": 0.05116603150963783,
      "pose_mae_dy": 0.055803969502449036,
      "pose_rmse_dtheta": 0.3830895721912384,
      "pose_rmse_dx": 0.14551855623722076,
      "pose_rmse_dy": 0.11790996044874191,
      "pose_rmse_mean": 0.21550604701042175,
      "rmse_dtheta": 0.04021219164133072,
      "rmse_dx": 0.015021339990198612,
      "rmse_dy": 0.006856827065348625,
      "rmse_mean": 0.020696787163615227,
      "rotation_flip": 0.007267442066222429,
      "sparse_tokens": 14600.0,
      "step": 5365,
      "turn_loss": 0.1709364354610443,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.2493031035123583,
      "grad_norm": 0.41644999384880066,
      "learning_rate": 5.913777656798722e-06,
      "loss": 0.1224,
      "mae_dtheta": 0.03658484295010567,
      "mae_dx": 0.01024209801107645,
      "mae_dy": 0.006129675544798374,
      "pose_mae_dtheta": 0.28642696142196655,
      "pose_mae_dx": 0.08368534594774246,
      "pose_mae_dy": 0.07143205404281616,
      "pose_rmse_dtheta": 0.5044757127761841,
      "pose_rmse_dx": 0.1797342598438263,
      "pose_rmse_dy": 0.1875123530626297,
      "pose_rmse_mean": 0.2905741035938263,
      "rmse_dtheta": 0.054966866970062256,
      "rmse_dx": 0.020900225266814232,
      "rmse_dy": 0.014115734957158566,
      "rmse_mean": 0.02999427728354931,
      "rotation_flip": 0.008421052247285843,
      "sparse_tokens": 15113.0,
      "step": 5366,
      "turn_loss": 0.29321110248565674,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24934956327820107,
      "grad_norm": 0.42633041739463806,
      "learning_rate": 5.912477674034757e-06,
      "loss": 0.1475,
      "mae_dtheta": 0.01001573633402586,
      "mae_dx": 0.0015818736283108592,
      "mae_dy": 0.0020945819560438395,
      "pose_mae_dtheta": 0.06830642372369766,
      "pose_mae_dx": 0.019839687272906303,
      "pose_mae_dy": 0.024609988555312157,
      "pose_rmse_dtheta": 0.17207001149654388,
      "pose_rmse_dx": 0.052330393344163895,
      "pose_rmse_dy": 0.05496054142713547,
      "pose_rmse_mean": 0.09312032163143158,
      "rmse_dtheta": 0.023435387760400772,
      "rmse_dx": 0.004554630257189274,
      "rmse_dy": 0.0049891057424247265,
      "rmse_mean": 0.010993041098117828,
      "rotation_flip": 0.003314394038170576,
      "sparse_tokens": 32073.0,
      "step": 5367,
      "turn_loss": 0.0876663401722908,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.24939602304404385,
      "grad_norm": 0.5485685467720032,
      "learning_rate": 5.911177627460739e-06,
      "loss": 0.1326,
      "mae_dtheta": 0.038829512894153595,
      "mae_dx": 0.011213185265660286,
      "mae_dy": 0.0041523948311805725,
      "pose_mae_dtheta": 0.3089391887187958,
      "pose_mae_dx": 0.07836563885211945,
      "pose_mae_dy": 0.04306083545088768,
      "pose_rmse_dtheta": 0.5816779136657715,
      "pose_rmse_dx": 0.2255474478006363,
      "pose_rmse_dy": 0.0962037667632103,
      "pose_rmse_mean": 0.3011430501937866,
      "rmse_dtheta": 0.060814280062913895,
      "rmse_dx": 0.025534486398100853,
      "rmse_dy": 0.008177896961569786,
      "rmse_mean": 0.03150888904929161,
      "rotation_flip": 0.005780346691608429,
      "sparse_tokens": 5502.0,
      "step": 5368,
      "turn_loss": 0.2841988205909729,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.24944248280988665,
      "grad_norm": 0.7526949048042297,
      "learning_rate": 5.90987751716758e-06,
      "loss": 0.1773,
      "mae_dtheta": 0.028267178684473038,
      "mae_dx": 0.006710420362651348,
      "mae_dy": 0.0059929657727479935,
      "pose_mae_dtheta": 0.22949199378490448,
      "pose_mae_dx": 0.056625109165906906,
      "pose_mae_dy": 0.05777668580412865,
      "pose_rmse_dtheta": 0.4514404237270355,
      "pose_rmse_dx": 0.13896359503269196,
      "pose_rmse_dy": 0.12808389961719513,
      "pose_rmse_mean": 0.23949597775936127,
      "rmse_dtheta": 0.046992357820272446,
      "rmse_dx": 0.01619165576994419,
      "rmse_dy": 0.01181701198220253,
      "rmse_mean": 0.025000344961881638,
      "rotation_flip": 0.014598540030419827,
      "sparse_tokens": 11526.0,
      "step": 5369,
      "turn_loss": 0.2548305094242096,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.24948894257572943,
      "grad_norm": 0.7750295400619507,
      "learning_rate": 5.908577343246197e-06,
      "loss": 0.1394,
      "mae_dtheta": 0.03288758546113968,
      "mae_dx": 0.010684102773666382,
      "mae_dy": 0.004349614027887583,
      "pose_mae_dtheta": 0.2607667148113251,
      "pose_mae_dx": 0.07466341555118561,
      "pose_mae_dy": 0.04076171666383743,
      "pose_rmse_dtheta": 0.49315914511680603,
      "pose_rmse_dx": 0.17972980439662933,
      "pose_rmse_dy": 0.09032168239355087,
      "pose_rmse_mean": 0.2544035315513611,
      "rmse_dtheta": 0.05473948270082474,
      "rmse_dx": 0.02269730716943741,
      "rmse_dy": 0.008962820284068584,
      "rmse_mean": 0.028799869120121002,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 6016.0,
      "step": 5370,
      "turn_loss": 0.21625272929668427,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.2495354023415722,
      "grad_norm": 0.37199196219444275,
      "learning_rate": 5.907277105787513e-06,
      "loss": 0.106,
      "mae_dtheta": 0.03392483666539192,
      "mae_dx": 0.009638984687626362,
      "mae_dy": 0.003688409924507141,
      "pose_mae_dtheta": 0.24457256495952606,
      "pose_mae_dx": 0.07542560994625092,
      "pose_mae_dy": 0.03905670717358589,
      "pose_rmse_dtheta": 0.4561854600906372,
      "pose_rmse_dx": 0.18263699114322662,
      "pose_rmse_dy": 0.08857813477516174,
      "pose_rmse_mean": 0.24246685206890106,
      "rmse_dtheta": 0.05386004224419594,
      "rmse_dx": 0.02081209607422352,
      "rmse_dy": 0.008188001811504364,
      "rmse_mean": 0.027620047330856323,
      "rotation_flip": 0.014517506584525108,
      "sparse_tokens": 19405.0,
      "step": 5371,
      "turn_loss": 0.21402506530284882,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.24958186210741498,
      "grad_norm": 0.5819042325019836,
      "learning_rate": 5.905976804882455e-06,
      "loss": 0.1833,
      "mae_dtheta": 0.03458496183156967,
      "mae_dx": 0.010969563387334347,
      "mae_dy": 0.00484240148216486,
      "pose_mae_dtheta": 0.31780073046684265,
      "pose_mae_dx": 0.08800546079874039,
      "pose_mae_dy": 0.06774130463600159,
      "pose_rmse_dtheta": 0.5285727381706238,
      "pose_rmse_dx": 0.21290981769561768,
      "pose_rmse_dy": 0.1733105331659317,
      "pose_rmse_mean": 0.30493104457855225,
      "rmse_dtheta": 0.05197112262248993,
      "rmse_dx": 0.023220743983983994,
      "rmse_dy": 0.01066669449210167,
      "rmse_mean": 0.028619524091482162,
      "rotation_flip": 0.014104371890425682,
      "sparse_tokens": 11054.0,
      "step": 5372,
      "turn_loss": 0.23895741999149323,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.24962832187325776,
      "grad_norm": 0.6123683452606201,
      "learning_rate": 5.904676440621952e-06,
      "loss": 0.1893,
      "mae_dtheta": 0.04338161274790764,
      "mae_dx": 0.011435911990702152,
      "mae_dy": 0.009040297009050846,
      "pose_mae_dtheta": 0.3396667242050171,
      "pose_mae_dx": 0.09072194993495941,
      "pose_mae_dy": 0.1202375665307045,
      "pose_rmse_dtheta": 0.5469565391540527,
      "pose_rmse_dx": 0.19981391727924347,
      "pose_rmse_dy": 0.22629931569099426,
      "pose_rmse_mean": 0.3243566155433655,
      "rmse_dtheta": 0.05986793339252472,
      "rmse_dx": 0.023297160863876343,
      "rmse_dy": 0.014641564339399338,
      "rmse_mean": 0.0326022207736969,
      "rotation_flip": 0.012835472822189331,
      "sparse_tokens": 13747.0,
      "step": 5373,
      "turn_loss": 0.3647112250328064,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.24967478163910053,
      "grad_norm": 0.8820357322692871,
      "learning_rate": 5.903376013096942e-06,
      "loss": 0.2174,
      "mae_dtheta": 0.03436753526329994,
      "mae_dx": 0.012189173139631748,
      "mae_dy": 0.008458241820335388,
      "pose_mae_dtheta": 0.25590890645980835,
      "pose_mae_dx": 0.10059862583875656,
      "pose_mae_dy": 0.09932118654251099,
      "pose_rmse_dtheta": 0.4819556176662445,
      "pose_rmse_dx": 0.20265300571918488,
      "pose_rmse_dy": 0.23141324520111084,
      "pose_rmse_mean": 0.30534064769744873,
      "rmse_dtheta": 0.053847361356019974,
      "rmse_dx": 0.02447434514760971,
      "rmse_dy": 0.018662821501493454,
      "rmse_mean": 0.032328180968761444,
      "rotation_flip": 0.012810851447284222,
      "sparse_tokens": 21519.0,
      "step": 5374,
      "turn_loss": 0.31881478428840637,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2497212414049433,
      "grad_norm": 0.40726009011268616,
      "learning_rate": 5.90207552239836e-06,
      "loss": 0.1505,
      "mae_dtheta": 0.01234358549118042,
      "mae_dx": 0.003469810588285327,
      "mae_dy": 0.0036545642651617527,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4072600305080414,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 163.60707092285156,
      "model/head/act_norm_mean": 109.17210187815657,
      "model/head/act_norm_min": 55.48807144165039,
      "model/head/act_over_embed": 75.0240904959902,
      "model/head/grad_frac": 0.12178245931863785,
      "model/head/grad_norm": 0.049597129225730896,
      "model/head/grad_zero_frac": 0.0001919494243338704,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6993913746843434,
      "model/head/update_ratio": 0.0008486422593705356,
      "model/head/weight_delta": 8.55174446105957,
      "model/head/weight_delta_rel": 0.15002292394638062,
      "model/head/weight_norm": 58.44291687011719,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42046961188316345,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4204100193998739,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42033851146698,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2889097012722067,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08801799267530441,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03584621101617813,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5463407371076233,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011591505026444793,
      "model/modality_embedder.encoders.pose/weight_delta": 2.7963130474090576,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09136426448822021,
      "model/modality_embedder.encoders.pose/weight_norm": 30.92455291748047,
      "model/modality_embedder/grad_frac": 0.08801799267530441,
      "model/modality_embedder/grad_norm": 0.03584621101617813,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5463407371076233,
      "model/modality_embedder/update_ratio": 0.0011591505026444793,
      "model/modality_embedder/weight_delta": 2.7963130474090576,
      "model/modality_embedder/weight_delta_rel": 0.09136426448822021,
      "model/modality_embedder/weight_norm": 30.92455291748047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.46360778808594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.59378006253006,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.095208168029785,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.21386654741976,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10435258597135544,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0424986369907856,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001527099753729999,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.1332180500030518,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07773575186729431,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.829641342163086,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.85464477539062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.56876302709636,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.354958534240723,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.883883968604046,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0874907523393631,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.035631485283374786,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001205650856718421,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.7025675773620605,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09361905604600906,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.553733825683594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.9605941772461,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.468324114157447,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.343291282653809,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.189280131603514,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08065712451934814,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03284842148423195,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010765993501991034,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.909932851791382,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09771009534597397,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.511276245117188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.12113952636719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.358129910213243,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.193962097167969,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.487972367293672,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07363205403089523,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02998739294707775,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010068445699289441,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.4851245880126953,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08492976427078247,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.783536911010742,
      "model/normalizer/grad_frac": 0.312069833278656,
      "model/normalizer/grad_norm": 0.12709356844425201,
      "model/normalizer/grad_zero_frac": 0.0002068042231258005,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016207797452807426,
      "model/normalizer/weight_delta": 5.267809867858887,
      "model/normalizer/weight_delta_rel": 0.06784634292125702,
      "model/normalizer/weight_norm": 78.41507720947266,
      "pose_mae_dtheta": 0.09326577186584473,
      "pose_mae_dx": 0.037181954830884933,
      "pose_mae_dy": 0.028597380965948105,
      "pose_rmse_dtheta": 0.24481576681137085,
      "pose_rmse_dx": 0.11473501473665237,
      "pose_rmse_dy": 0.0668373703956604,
      "pose_rmse_mean": 0.14212939143180847,
      "rmse_dtheta": 0.028017820790410042,
      "rmse_dx": 0.00978731457144022,
      "rmse_dy": 0.008553593419492245,
      "rmse_mean": 0.015452910214662552,
      "rotation_flip": 0.007726718205958605,
      "sparse_tokens": 32105.0,
      "step": 5375,
      "turn_loss": 0.10807313770055771,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2497677011707861,
      "grad_norm": 0.5383142828941345,
      "learning_rate": 5.9007749686171534e-06,
      "loss": 0.1072,
      "mae_dtheta": 0.011595371179282665,
      "mae_dx": 0.0036012872587889433,
      "mae_dy": 0.005384090356528759,
      "pose_mae_dtheta": 0.07787062227725983,
      "pose_mae_dx": 0.043867528438568115,
      "pose_mae_dy": 0.036666568368673325,
      "pose_rmse_dtheta": 0.16552677750587463,
      "pose_rmse_dx": 0.12660272419452667,
      "pose_rmse_dy": 0.08357861638069153,
      "pose_rmse_mean": 0.12523604929447174,
      "rmse_dtheta": 0.02218739502131939,
      "rmse_dx": 0.00908645335584879,
      "rmse_dy": 0.01210142020136118,
      "rmse_mean": 0.014458423480391502,
      "rotation_flip": 0.004116638097912073,
      "sparse_tokens": 32105.0,
      "step": 5376,
      "turn_loss": 0.1163824275135994,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.2498141609366289,
      "grad_norm": 0.41094475984573364,
      "learning_rate": 5.89947435184427e-06,
      "loss": 0.0973,
      "mae_dtheta": 0.036518245935440063,
      "mae_dx": 0.010807850398123264,
      "mae_dy": 0.00491651427000761,
      "pose_mae_dtheta": 0.27415546774864197,
      "pose_mae_dx": 0.1018768772482872,
      "pose_mae_dy": 0.05973847955465317,
      "pose_rmse_dtheta": 0.5330793857574463,
      "pose_rmse_dx": 0.23691010475158691,
      "pose_rmse_dy": 0.14648769795894623,
      "pose_rmse_mean": 0.3054924011230469,
      "rmse_dtheta": 0.05774509534239769,
      "rmse_dx": 0.02431578002870083,
      "rmse_dy": 0.009563676081597805,
      "rmse_mean": 0.030541516840457916,
      "rotation_flip": 0.015659954398870468,
      "sparse_tokens": 8820.0,
      "step": 5377,
      "turn_loss": 0.25021886825561523,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.24986062070247167,
      "grad_norm": 0.30879056453704834,
      "learning_rate": 5.898173672170662e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.012770989909768105,
      "mae_dx": 0.0018827790627256036,
      "mae_dy": 0.002925085835158825,
      "pose_mae_dtheta": 0.085948646068573,
      "pose_mae_dx": 0.02734375186264515,
      "pose_mae_dy": 0.03890230506658554,
      "pose_rmse_dtheta": 0.16904117166996002,
      "pose_rmse_dx": 0.06767196953296661,
      "pose_rmse_dy": 0.07884982228279114,
      "pose_rmse_mean": 0.10518765449523926,
      "rmse_dtheta": 0.02401553839445114,
      "rmse_dx": 0.006342773325741291,
      "rmse_dy": 0.006012186873704195,
      "rmse_mean": 0.012123499065637589,
      "rotation_flip": 0.00528355035930872,
      "sparse_tokens": 32073.0,
      "step": 5378,
      "turn_loss": 0.0991242527961731,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.24990708046831445,
      "grad_norm": 0.4519025683403015,
      "learning_rate": 5.896872929687287e-06,
      "loss": 0.0789,
      "mae_dtheta": 0.008115489967167377,
      "mae_dx": 0.0020283516496419907,
      "mae_dy": 0.002157722134143114,
      "pose_mae_dtheta": 0.04931062459945679,
      "pose_mae_dx": 0.023891746997833252,
      "pose_mae_dy": 0.02069929800927639,
      "pose_rmse_dtheta": 0.11178746819496155,
      "pose_rmse_dx": 0.06298955529928207,
      "pose_rmse_dy": 0.05043712258338928,
      "pose_rmse_mean": 0.07507138699293137,
      "rmse_dtheta": 0.017396437004208565,
      "rmse_dx": 0.005754087585955858,
      "rmse_dy": 0.005108697805553675,
      "rmse_mean": 0.009419741109013557,
      "rotation_flip": 0.003930817823857069,
      "sparse_tokens": 32121.0,
      "step": 5379,
      "turn_loss": 0.07611765712499619,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.24995354023415722,
      "grad_norm": 0.44760116934776306,
      "learning_rate": 5.895572124485107e-06,
      "loss": 0.0854,
      "mae_dtheta": 0.038536690175533295,
      "mae_dx": 0.009620009921491146,
      "mae_dy": 0.008537503890693188,
      "pose_mae_dtheta": 0.32739511132240295,
      "pose_mae_dx": 0.07275361567735672,
      "pose_mae_dy": 0.10436780005693436,
      "pose_rmse_dtheta": 0.5796549320220947,
      "pose_rmse_dx": 0.17398715019226074,
      "pose_rmse_dy": 0.2387310266494751,
      "pose_rmse_mean": 0.33079105615615845,
      "rmse_dtheta": 0.05826995149254799,
      "rmse_dx": 0.020844077691435814,
      "rmse_dy": 0.017750408500432968,
      "rmse_mean": 0.032288145273923874,
      "rotation_flip": 0.018789144232869148,
      "sparse_tokens": 8232.0,
      "step": 5380,
      "turn_loss": 0.31154516339302063,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.25,
      "grad_norm": 0.44022446870803833,
      "learning_rate": 5.894271256655089e-06,
      "loss": 0.1442,
      "mae_dtheta": 0.021278856322169304,
      "mae_dx": 0.008720533922314644,
      "mae_dy": 0.001354088424704969,
      "pose_mae_dtheta": 0.17555896937847137,
      "pose_mae_dx": 0.05975668877363205,
      "pose_mae_dy": 0.016382580623030663,
      "pose_rmse_dtheta": 0.34748905897140503,
      "pose_rmse_dx": 0.17603559792041779,
      "pose_rmse_dy": 0.03660564869642258,
      "pose_rmse_mean": 0.18671010434627533,
      "rmse_dtheta": 0.038569461554288864,
      "rmse_dx": 0.020857516676187515,
      "rmse_dy": 0.0028409294318407774,
      "rmse_mean": 0.020755968987941742,
      "rotation_flip": 0.006006006151437759,
      "sparse_tokens": 7598.0,
      "step": 5381,
      "turn_loss": 0.13029912114143372,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2500464597658428,
      "grad_norm": 0.33556631207466125,
      "learning_rate": 5.8929703262882e-06,
      "loss": 0.0947,
      "mae_dtheta": 0.00838159304112196,
      "mae_dx": 0.0011669540544971824,
      "mae_dy": 0.001708636642433703,
      "pose_mae_dtheta": 0.053053099662065506,
      "pose_mae_dx": 0.01640402339398861,
      "pose_mae_dy": 0.019202157855033875,
      "pose_rmse_dtheta": 0.1547948271036148,
      "pose_rmse_dx": 0.04230867326259613,
      "pose_rmse_dy": 0.04755261912941933,
      "pose_rmse_mean": 0.08155204355716705,
      "rmse_dtheta": 0.02151358872652054,
      "rmse_dx": 0.0035139599349349737,
      "rmse_dy": 0.0040285419672727585,
      "rmse_mean": 0.009685363620519638,
      "rotation_flip": 0.0026525198481976986,
      "sparse_tokens": 32105.0,
      "step": 5382,
      "turn_loss": 0.06234839931130409,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.25009291953168555,
      "grad_norm": 0.48927435278892517,
      "learning_rate": 5.891669333475416e-06,
      "loss": 0.1405,
      "mae_dtheta": 0.04249080643057823,
      "mae_dx": 0.016977552324533463,
      "mae_dy": 0.00469003152102232,
      "pose_mae_dtheta": 0.35013478994369507,
      "pose_mae_dx": 0.11501302570104599,
      "pose_mae_dy": 0.06142314523458481,
      "pose_rmse_dtheta": 0.6516629457473755,
      "pose_rmse_dx": 0.25195980072021484,
      "pose_rmse_dy": 0.16939127445220947,
      "pose_rmse_mean": 0.3576713502407074,
      "rmse_dtheta": 0.06522238254547119,
      "rmse_dx": 0.03173946961760521,
      "rmse_dy": 0.009826282039284706,
      "rmse_mean": 0.03559604659676552,
      "rotation_flip": 0.002577319508418441,
      "sparse_tokens": 6269.0,
      "step": 5383,
      "turn_loss": 0.32989099621772766,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.25013937929752833,
      "grad_norm": 0.5235430598258972,
      "learning_rate": 5.8903682783077185e-06,
      "loss": 0.129,
      "mae_dtheta": 0.036671578884124756,
      "mae_dx": 0.008555756881833076,
      "mae_dy": 0.002953486517071724,
      "pose_mae_dtheta": 0.30916669964790344,
      "pose_mae_dx": 0.07823797315359116,
      "pose_mae_dy": 0.03643878176808357,
      "pose_rmse_dtheta": 0.6205102801322937,
      "pose_rmse_dx": 0.16118276119232178,
      "pose_rmse_dy": 0.07420746982097626,
      "pose_rmse_mean": 0.28530019521713257,
      "rmse_dtheta": 0.05883532389998436,
      "rmse_dx": 0.017860032618045807,
      "rmse_dy": 0.005254629533737898,
      "rmse_mean": 0.027316659688949585,
      "rotation_flip": 0.008571428246796131,
      "sparse_tokens": 5595.0,
      "step": 5384,
      "turn_loss": 0.21490192413330078,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2501858390633711,
      "grad_norm": 0.4355129301548004,
      "learning_rate": 5.889067160876091e-06,
      "loss": 0.1517,
      "mae_dtheta": 0.01219317875802517,
      "mae_dx": 0.0024219187907874584,
      "mae_dy": 0.0029427572153508663,
      "pose_mae_dtheta": 0.08349812775850296,
      "pose_mae_dx": 0.028558842837810516,
      "pose_mae_dy": 0.03637304529547691,
      "pose_rmse_dtheta": 0.18493902683258057,
      "pose_rmse_dx": 0.07188918441534042,
      "pose_rmse_dy": 0.098349928855896,
      "pose_rmse_mean": 0.11839272081851959,
      "rmse_dtheta": 0.02467007376253605,
      "rmse_dx": 0.007520926650613546,
      "rmse_dy": 0.006705602165311575,
      "rmse_mean": 0.012965533882379532,
      "rotation_flip": 0.005369127728044987,
      "sparse_tokens": 32089.0,
      "step": 5385,
      "turn_loss": 0.10217887163162231,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2502322988292139,
      "grad_norm": 0.43155765533447266,
      "learning_rate": 5.887765981271518e-06,
      "loss": 0.1252,
      "mae_dtheta": 0.007956226356327534,
      "mae_dx": 0.0011991702485829592,
      "mae_dy": 0.0011428993893787265,
      "pose_mae_dtheta": 0.05917710065841675,
      "pose_mae_dx": 0.014295926317572594,
      "pose_mae_dy": 0.015894317999482155,
      "pose_rmse_dtheta": 0.20279985666275024,
      "pose_rmse_dx": 0.039131827652454376,
      "pose_rmse_dy": 0.04761616140604019,
      "pose_rmse_mean": 0.0965159460902214,
      "rmse_dtheta": 0.02384849824011326,
      "rmse_dx": 0.004009171389043331,
      "rmse_dy": 0.002690949710085988,
      "rmse_mean": 0.010182873345911503,
      "rotation_flip": 0.0,
      "sparse_tokens": 32105.0,
      "step": 5386,
      "turn_loss": 0.053174134343862534,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.25027875859505666,
      "grad_norm": 0.4304940402507782,
      "learning_rate": 5.886464739584993e-06,
      "loss": 0.1131,
      "mae_dtheta": 0.01084993313997984,
      "mae_dx": 0.0028388691134750843,
      "mae_dy": 0.0026630875654518604,
      "pose_mae_dtheta": 0.07122844457626343,
      "pose_mae_dx": 0.032470703125,
      "pose_mae_dy": 0.03040032833814621,
      "pose_rmse_dtheta": 0.18054679036140442,
      "pose_rmse_dx": 0.08740910142660141,
      "pose_rmse_dy": 0.06919503957033157,
      "pose_rmse_mean": 0.1123836487531662,
      "rmse_dtheta": 0.0245506688952446,
      "rmse_dx": 0.009011364541947842,
      "rmse_dy": 0.0059281629510223866,
      "rmse_mean": 0.013163398951292038,
      "rotation_flip": 0.004581424407660961,
      "sparse_tokens": 32121.0,
      "step": 5387,
      "turn_loss": 0.11428817361593246,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.25032521836089944,
      "grad_norm": 0.5230730772018433,
      "learning_rate": 5.885163435907514e-06,
      "loss": 0.1676,
      "mae_dtheta": 0.033775605261325836,
      "mae_dx": 0.01676124893128872,
      "mae_dy": 0.006827375385910273,
      "pose_mae_dtheta": 0.26293399930000305,
      "pose_mae_dx": 0.1280304491519928,
      "pose_mae_dy": 0.06439515203237534,
      "pose_rmse_dtheta": 0.44592592120170593,
      "pose_rmse_dx": 0.24626311659812927,
      "pose_rmse_dy": 0.15369626879692078,
      "pose_rmse_mean": 0.2819617688655853,
      "rmse_dtheta": 0.04960007965564728,
      "rmse_dx": 0.03073936514556408,
      "rmse_dy": 0.013499037362635136,
      "rmse_mean": 0.03127949684858322,
      "rotation_flip": 0.019438445568084717,
      "sparse_tokens": 14475.0,
      "step": 5388,
      "turn_loss": 0.34210318326950073,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2503716781267422,
      "grad_norm": 0.33759716153144836,
      "learning_rate": 5.883862070330079e-06,
      "loss": 0.084,
      "mae_dtheta": 0.007462749723345041,
      "mae_dx": 0.0017788243712857366,
      "mae_dy": 0.0010150321759283543,
      "pose_mae_dtheta": 0.05269622802734375,
      "pose_mae_dx": 0.0169698353856802,
      "pose_mae_dy": 0.013723418116569519,
      "pose_rmse_dtheta": 0.1660364717245102,
      "pose_rmse_dx": 0.046488795429468155,
      "pose_rmse_dy": 0.038411252200603485,
      "pose_rmse_mean": 0.08364550769329071,
      "rmse_dtheta": 0.020956167951226234,
      "rmse_dx": 0.005530154798179865,
      "rmse_dy": 0.0027395577635616064,
      "rmse_mean": 0.00974196009337902,
      "rotation_flip": 0.0016620499081909657,
      "sparse_tokens": 32169.0,
      "step": 5389,
      "turn_loss": 0.06289467960596085,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.25041813789258505,
      "grad_norm": 1.3483071327209473,
      "learning_rate": 5.882560642943697e-06,
      "loss": 0.2596,
      "mae_dtheta": 0.032707322388887405,
      "mae_dx": 0.007661570329219103,
      "mae_dy": 0.006565575022250414,
      "pose_mae_dtheta": 0.24847890436649323,
      "pose_mae_dx": 0.086115263402462,
      "pose_mae_dy": 0.07794900983572006,
      "pose_rmse_dtheta": 0.41123390197753906,
      "pose_rmse_dx": 0.15183298289775848,
      "pose_rmse_dy": 0.18814249336719513,
      "pose_rmse_mean": 0.25040313601493835,
      "rmse_dtheta": 0.04732746630907059,
      "rmse_dx": 0.016080601140856743,
      "rmse_dy": 0.01147066056728363,
      "rmse_mean": 0.02495957724750042,
      "rotation_flip": 0.01075268816202879,
      "sparse_tokens": 4531.0,
      "step": 5390,
      "turn_loss": 0.20209909975528717,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2504645976584278,
      "grad_norm": 0.5569158792495728,
      "learning_rate": 5.8812591538393735e-06,
      "loss": 0.1404,
      "mae_dtheta": 0.012741489335894585,
      "mae_dx": 0.0019034382421523333,
      "mae_dy": 0.0026022479869425297,
      "pose_mae_dtheta": 0.08837169408798218,
      "pose_mae_dx": 0.02784538082778454,
      "pose_mae_dy": 0.03480411693453789,
      "pose_rmse_dtheta": 0.19458386301994324,
      "pose_rmse_dx": 0.0711105614900589,
      "pose_rmse_dy": 0.07223699986934662,
      "pose_rmse_mean": 0.11264382302761078,
      "rmse_dtheta": 0.024659017100930214,
      "rmse_dx": 0.006349544506520033,
      "rmse_dy": 0.005115314852446318,
      "rmse_mean": 0.012041292153298855,
      "rotation_flip": 0.0037112010177224874,
      "sparse_tokens": 32089.0,
      "step": 5391,
      "turn_loss": 0.08598724752664566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2505110574242706,
      "grad_norm": 0.5797183513641357,
      "learning_rate": 5.879957603108126e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.008675817400217056,
      "mae_dx": 0.001641790964640677,
      "mae_dy": 0.0014371477300301194,
      "pose_mae_dtheta": 0.06446254253387451,
      "pose_mae_dx": 0.016678597778081894,
      "pose_mae_dy": 0.021053772419691086,
      "pose_rmse_dtheta": 0.2338986098766327,
      "pose_rmse_dx": 0.06184019148349762,
      "pose_rmse_dy": 0.07504082471132278,
      "pose_rmse_mean": 0.12359321117401123,
      "rmse_dtheta": 0.02469855360686779,
      "rmse_dx": 0.0063004689291119576,
      "rmse_dy": 0.003986854571849108,
      "rmse_mean": 0.011661959812045097,
      "rotation_flip": 0.005924170836806297,
      "sparse_tokens": 32073.0,
      "step": 5392,
      "turn_loss": 0.06965344399213791,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2505575171901134,
      "grad_norm": 0.4232986271381378,
      "learning_rate": 5.8786559908409715e-06,
      "loss": 0.1131,
      "mae_dtheta": 0.009457775391638279,
      "mae_dx": 0.0017221138114109635,
      "mae_dy": 0.002582986606284976,
      "pose_mae_dtheta": 0.06139415502548218,
      "pose_mae_dx": 0.014929797500371933,
      "pose_mae_dy": 0.022499874234199524,
      "pose_rmse_dtheta": 0.1491502970457077,
      "pose_rmse_dx": 0.035633593797683716,
      "pose_rmse_dy": 0.052616871893405914,
      "pose_rmse_mean": 0.07913359254598618,
      "rmse_dtheta": 0.021672360599040985,
      "rmse_dx": 0.005474489647895098,
      "rmse_dy": 0.007288963533937931,
      "rmse_mean": 0.0114786047488451,
      "rotation_flip": 0.005729564465582371,
      "sparse_tokens": 32121.0,
      "step": 5393,
      "turn_loss": 0.08642309159040451,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.25060397695595615,
      "grad_norm": 0.4644200801849365,
      "learning_rate": 5.87735431712893e-06,
      "loss": 0.0957,
      "mae_dtheta": 0.007995106279850006,
      "mae_dx": 0.0016274757217615843,
      "mae_dy": 0.00030060773133300245,
      "pose_mae_dtheta": 0.06090299412608147,
      "pose_mae_dx": 0.012765347957611084,
      "pose_mae_dy": 0.00493296654894948,
      "pose_rmse_dtheta": 0.24354225397109985,
      "pose_rmse_dx": 0.03974252566695213,
      "pose_rmse_dy": 0.0203066598623991,
      "pose_rmse_mean": 0.10119714587926865,
      "rmse_dtheta": 0.029053693637251854,
      "rmse_dx": 0.00511534046381712,
      "rmse_dy": 0.0007454724400304258,
      "rmse_mean": 0.01163816824555397,
      "rotation_flip": 0.0006570302066393197,
      "sparse_tokens": 32201.0,
      "step": 5394,
      "turn_loss": 0.041554708033800125,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.25065043672179893,
      "grad_norm": 0.6251713037490845,
      "learning_rate": 5.876052582063031e-06,
      "loss": 0.1542,
      "mae_dtheta": 0.03928714618086815,
      "mae_dx": 0.012652593664824963,
      "mae_dy": 0.004922608379274607,
      "pose_mae_dtheta": 0.29798752069473267,
      "pose_mae_dx": 0.10721205919981003,
      "pose_mae_dy": 0.04557424411177635,
      "pose_rmse_dtheta": 0.5473454594612122,
      "pose_rmse_dx": 0.2587199807167053,
      "pose_rmse_dy": 0.08575521409511566,
      "pose_rmse_mean": 0.29727357625961304,
      "rmse_dtheta": 0.059489425271749496,
      "rmse_dx": 0.026432808488607407,
      "rmse_dy": 0.00855378620326519,
      "rmse_mean": 0.03149200975894928,
      "rotation_flip": 0.01122194528579712,
      "sparse_tokens": 15158.0,
      "step": 5395,
      "turn_loss": 0.2617294192314148,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2506968964876417,
      "grad_norm": 0.46353012323379517,
      "learning_rate": 5.874750785734305e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.012531236745417118,
      "mae_dx": 0.00269804778508842,
      "mae_dy": 0.0036779132205992937,
      "pose_mae_dtheta": 0.08106092363595963,
      "pose_mae_dx": 0.033954378217458725,
      "pose_mae_dy": 0.03875980153679848,
      "pose_rmse_dtheta": 0.19746741652488708,
      "pose_rmse_dx": 0.10168793797492981,
      "pose_rmse_dy": 0.09019249677658081,
      "pose_rmse_mean": 0.12978261709213257,
      "rmse_dtheta": 0.024516012519598007,
      "rmse_dx": 0.008764849975705147,
      "rmse_dy": 0.008898037485778332,
      "rmse_mean": 0.014059634879231453,
      "rotation_flip": 0.009317927993834019,
      "sparse_tokens": 32073.0,
      "step": 5396,
      "turn_loss": 0.11823656409978867,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.2507433562534845,
      "grad_norm": 0.5003082752227783,
      "learning_rate": 5.873448928233787e-06,
      "loss": 0.1689,
      "mae_dtheta": 0.04313212260603905,
      "mae_dx": 0.01128940936177969,
      "mae_dy": 0.005285297986119986,
      "pose_mae_dtheta": 0.376110315322876,
      "pose_mae_dx": 0.085465207695961,
      "pose_mae_dy": 0.05041525140404701,
      "pose_rmse_dtheta": 0.6434855461120605,
      "pose_rmse_dx": 0.18429312109947205,
      "pose_rmse_dy": 0.15284623205661774,
      "pose_rmse_mean": 0.3268749713897705,
      "rmse_dtheta": 0.06471142917871475,
      "rmse_dx": 0.022420339286327362,
      "rmse_dy": 0.0131988525390625,
      "rmse_mean": 0.03344354033470154,
      "rotation_flip": 0.013357079587876797,
      "sparse_tokens": 18334.0,
      "step": 5397,
      "turn_loss": 0.33321958780288696,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 32987.0,
      "epoch": 0.25078981601932726,
      "grad_norm": 0.5090968012809753,
      "learning_rate": 5.8721470096525176e-06,
      "loss": 0.1797,
      "mae_dtheta": 0.04032275825738907,
      "mae_dx": 0.01294822059571743,
      "mae_dy": 0.006525837350636721,
      "pose_mae_dtheta": 0.31989097595214844,
      "pose_mae_dx": 0.10352545976638794,
      "pose_mae_dy": 0.08282174915075302,
      "pose_rmse_dtheta": 0.5556566119194031,
      "pose_rmse_dx": 0.2363557070493698,
      "pose_rmse_dy": 0.17454136908054352,
      "pose_rmse_mean": 0.32218456268310547,
      "rmse_dtheta": 0.05976813659071922,
      "rmse_dx": 0.025936447083950043,
      "rmse_dy": 0.012466507963836193,
      "rmse_mean": 0.032723695039749146,
      "rotation_flip": 0.013681592419743538,
      "sparse_tokens": 24450.0,
      "step": 5398,
      "turn_loss": 0.2960345447063446,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.25083627578517004,
      "grad_norm": 0.5772942304611206,
      "learning_rate": 5.870845030081539e-06,
      "loss": 0.136,
      "mae_dtheta": 0.041262686252593994,
      "mae_dx": 0.013885093852877617,
      "mae_dy": 0.006916902959346771,
      "pose_mae_dtheta": 0.33094432950019836,
      "pose_mae_dx": 0.12835721671581268,
      "pose_mae_dy": 0.09845613688230515,
      "pose_rmse_dtheta": 0.579357922077179,
      "pose_rmse_dx": 0.24976256489753723,
      "pose_rmse_dy": 0.18944762647151947,
      "pose_rmse_mean": 0.33952271938323975,
      "rmse_dtheta": 0.060855429619550705,
      "rmse_dx": 0.025790415704250336,
      "rmse_dy": 0.014388601295650005,
      "rmse_mean": 0.033678147941827774,
      "rotation_flip": 0.010554090142250061,
      "sparse_tokens": 6769.0,
      "step": 5399,
      "turn_loss": 0.3611631393432617,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.2508827355510128,
      "grad_norm": 0.5823498368263245,
      "learning_rate": 5.8695429896118994e-06,
      "loss": 0.1754,
      "mae_dtheta": 0.03976987302303314,
      "mae_dx": 0.012053806334733963,
      "mae_dy": 0.007128520403057337,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5823497176170349,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 143.8720245361328,
      "model/head/act_norm_mean": 113.43048650568181,
      "model/head/act_norm_min": 73.74211120605469,
      "model/head/act_over_embed": 77.95049227965055,
      "model/head/grad_frac": 0.11295966058969498,
      "model/head/grad_norm": 0.06578202545642853,
      "model/head/grad_zero_frac": 0.00019702577264979482,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6998106060606061,
      "model/head/update_ratio": 0.001125502516515553,
      "model/head/weight_delta": 8.57076644897461,
      "model/head/weight_delta_rel": 0.15035663545131683,
      "model/head/weight_norm": 58.44680404663086,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42046058177948,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42046058177948,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42046058177948,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2889444482128445,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07330109924077988,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04268687590956688,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.552734375,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013803238980472088,
      "model/modality_embedder.encoders.pose/weight_delta": 2.799300193786621,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09146185964345932,
      "model/modality_embedder.encoders.pose/weight_norm": 30.925260543823242,
      "model/modality_embedder/grad_frac": 0.07330109924077988,
      "model/modality_embedder/grad_norm": 0.04268687590956688,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.552734375,
      "model/modality_embedder/update_ratio": 0.0013803238980472088,
      "model/modality_embedder/weight_delta": 2.799300193786621,
      "model/modality_embedder/weight_delta_rel": 0.09146185964345932,
      "model/modality_embedder/weight_norm": 30.925260543823242,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.50509643554688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.920813416907166,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.031941413879395,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.438606930282205,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08722149580717087,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05079341307282448,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018250704742968082,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.1396870613098145,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07797148823738098,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.8309326171875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.98253631591797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.72248151154401,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.716614723205566,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.989520750251597,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09491313248872757,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05527263507246971,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001870080828666687,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.7109336853027344,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09390886127948761,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.55628204345703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.50248718261719,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.324265722703224,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.804875373840332,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.090281856300262,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.1092359647154808,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06361353397369385,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00208475929684937,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.918837547302246,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09800910204648972,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.51361083984375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.97266387939453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.212908474627223,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.858173370361328,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.388174837174457,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11275569349527359,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06566324830055237,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022045427467674017,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.492140531539917,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08516953885555267,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.785429000854492,
      "model/normalizer/grad_frac": 0.42304936051368713,
      "model/normalizer/grad_norm": 0.24636267125606537,
      "model/normalizer/grad_zero_frac": 0.00020562247664202005,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0031416735146194696,
      "model/normalizer/weight_delta": 5.283504009246826,
      "model/normalizer/weight_delta_rel": 0.06804846972227097,
      "model/normalizer/weight_norm": 78.41765594482422,
      "pose_mae_dtheta": 0.28611278533935547,
      "pose_mae_dx": 0.0976792722940445,
      "pose_mae_dy": 0.10186050832271576,
      "pose_rmse_dtheta": 0.4745699465274811,
      "pose_rmse_dx": 0.20780247449874878,
      "pose_rmse_dy": 0.2059113085269928,
      "pose_rmse_mean": 0.2960945963859558,
      "rmse_dtheta": 0.056093018501996994,
      "rmse_dx": 0.02447672374546528,
      "rmse_dy": 0.01336759515106678,
      "rmse_mean": 0.03131244704127312,
      "rotation_flip": 0.02063789777457714,
      "sparse_tokens": 8335.0,
      "step": 5400,
      "turn_loss": 0.2710624039173126,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "epoch": 0.2508827355510128,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31546342372894287,
      "eval_objectnav_nopose_mae_dtheta": 0.04028409719467163,
      "eval_objectnav_nopose_mae_dx": 0.013262169435620308,
      "eval_objectnav_nopose_mae_dy": 0.005212917923927307,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3253866136074066,
      "eval_objectnav_nopose_pose_mae_dx": 0.10625013709068298,
      "eval_objectnav_nopose_pose_mae_dy": 0.0579315647482872,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5552462935447693,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2367972582578659,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1374465525150299,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30983003973960876,
      "eval_objectnav_nopose_rmse_dtheta": 0.05859140679240227,
      "eval_objectnav_nopose_rmse_dx": 0.026136670261621475,
      "eval_objectnav_nopose_rmse_dy": 0.010855533182621002,
      "eval_objectnav_nopose_rmse_mean": 0.03186120465397835,
      "eval_objectnav_nopose_rotation_flip": 0.014745308086276054,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31546342372894287,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 5400
    },
    {
      "epoch": 0.2508827355510128,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2888890206813812,
      "eval_objectnav_pose_mae_dtheta": 0.03660972788929939,
      "eval_objectnav_pose_mae_dx": 0.011552544310688972,
      "eval_objectnav_pose_mae_dy": 0.004875469487160444,
      "eval_objectnav_pose_pose_mae_dtheta": 0.28174465894699097,
      "eval_objectnav_pose_pose_mae_dx": 0.09273575246334076,
      "eval_objectnav_pose_pose_mae_dy": 0.05213800072669983,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.49813112616539,
      "eval_objectnav_pose_pose_rmse_dx": 0.21410538256168365,
      "eval_objectnav_pose_pose_rmse_dy": 0.1265067756175995,
      "eval_objectnav_pose_pose_rmse_mean": 0.27958112955093384,
      "eval_objectnav_pose_rmse_dtheta": 0.054964032024145126,
      "eval_objectnav_pose_rmse_dx": 0.0239303819835186,
      "eval_objectnav_pose_rmse_dy": 0.010609491728246212,
      "eval_objectnav_pose_rmse_mean": 0.02983463555574417,
      "eval_objectnav_pose_rotation_flip": 0.01429247297346592,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2888890206813812,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 5400
    },
    {
      "epoch": 0.2508827355510128,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09693454951047897,
      "eval_pointnav_mae_dtheta": 0.010727308690547943,
      "eval_pointnav_mae_dx": 0.0025739623233675957,
      "eval_pointnav_mae_dy": 0.0024635260924696922,
      "eval_pointnav_pose_mae_dtheta": 0.07613860815763474,
      "eval_pointnav_pose_mae_dx": 0.02879701927304268,
      "eval_pointnav_pose_mae_dy": 0.027022503316402435,
      "eval_pointnav_pose_rmse_dtheta": 0.2101764678955078,
      "eval_pointnav_pose_rmse_dx": 0.08794710785150528,
      "eval_pointnav_pose_rmse_dy": 0.07960917800664902,
      "eval_pointnav_pose_rmse_mean": 0.1259109228849411,
      "eval_pointnav_rmse_dtheta": 0.026028843596577644,
      "eval_pointnav_rmse_dx": 0.00804704986512661,
      "eval_pointnav_rmse_dy": 0.006718285847455263,
      "eval_pointnav_rmse_mean": 0.013598060235381126,
      "eval_pointnav_rotation_flip": 0.004321867600083351,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09693454951047897,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 5400
    },
    {
      "epoch": 0.2508827355510128,
      "eval_loss": 0.23376233130693436,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31546342372894287,
      "eval_objectnav_nopose_mae_dtheta": 0.04028409719467163,
      "eval_objectnav_nopose_mae_dx": 0.013262169435620308,
      "eval_objectnav_nopose_mae_dy": 0.005212917923927307,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3253866136074066,
      "eval_objectnav_nopose_pose_mae_dx": 0.10625013709068298,
      "eval_objectnav_nopose_pose_mae_dy": 0.0579315647482872,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5552462935447693,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2367972582578659,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1374465525150299,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30983003973960876,
      "eval_objectnav_nopose_rmse_dtheta": 0.05859140679240227,
      "eval_objectnav_nopose_rmse_dx": 0.026136670261621475,
      "eval_objectnav_nopose_rmse_dy": 0.010855533182621002,
      "eval_objectnav_nopose_rmse_mean": 0.03186120465397835,
      "eval_objectnav_nopose_rotation_flip": 0.014745308086276054,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31546342372894287,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2888890206813812,
      "eval_objectnav_pose_mae_dtheta": 0.03660972788929939,
      "eval_objectnav_pose_mae_dx": 0.011552544310688972,
      "eval_objectnav_pose_mae_dy": 0.004875469487160444,
      "eval_objectnav_pose_pose_mae_dtheta": 0.28174465894699097,
      "eval_objectnav_pose_pose_mae_dx": 0.09273575246334076,
      "eval_objectnav_pose_pose_mae_dy": 0.05213800072669983,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.49813112616539,
      "eval_objectnav_pose_pose_rmse_dx": 0.21410538256168365,
      "eval_objectnav_pose_pose_rmse_dy": 0.1265067756175995,
      "eval_objectnav_pose_pose_rmse_mean": 0.27958112955093384,
      "eval_objectnav_pose_rmse_dtheta": 0.054964032024145126,
      "eval_objectnav_pose_rmse_dx": 0.0239303819835186,
      "eval_objectnav_pose_rmse_dy": 0.010609491728246212,
      "eval_objectnav_pose_rmse_mean": 0.02983463555574417,
      "eval_objectnav_pose_rotation_flip": 0.01429247297346592,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2888890206813812,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09693454951047897,
      "eval_pointnav_mae_dtheta": 0.010727308690547943,
      "eval_pointnav_mae_dx": 0.0025739623233675957,
      "eval_pointnav_mae_dy": 0.0024635260924696922,
      "eval_pointnav_pose_mae_dtheta": 0.07613860815763474,
      "eval_pointnav_pose_mae_dx": 0.02879701927304268,
      "eval_pointnav_pose_mae_dy": 0.027022503316402435,
      "eval_pointnav_pose_rmse_dtheta": 0.2101764678955078,
      "eval_pointnav_pose_rmse_dx": 0.08794710785150528,
      "eval_pointnav_pose_rmse_dy": 0.07960917800664902,
      "eval_pointnav_pose_rmse_mean": 0.1259109228849411,
      "eval_pointnav_rmse_dtheta": 0.026028843596577644,
      "eval_pointnav_rmse_dx": 0.00804704986512661,
      "eval_pointnav_rmse_dy": 0.006718285847455263,
      "eval_pointnav_rmse_mean": 0.013598060235381126,
      "eval_pointnav_rotation_flip": 0.004321867600083351,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09693454951047897,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 5400
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2509291953168556,
      "grad_norm": 0.48398357629776,
      "learning_rate": 5.8682408883346535e-06,
      "loss": 0.0908,
      "mae_dtheta": 0.010422803461551666,
      "mae_dx": 0.0023487601429224014,
      "mae_dy": 0.0027642848435789347,
      "pose_mae_dtheta": 0.074960857629776,
      "pose_mae_dx": 0.03307928889989853,
      "pose_mae_dy": 0.036794424057006836,
      "pose_rmse_dtheta": 0.15569014847278595,
      "pose_rmse_dx": 0.09366095811128616,
      "pose_rmse_dy": 0.09485926479101181,
      "pose_rmse_mean": 0.11473679542541504,
      "rmse_dtheta": 0.02114495448768139,
      "rmse_dx": 0.007577115204185247,
      "rmse_dy": 0.006550972815603018,
      "rmse_mean": 0.011757681146264076,
      "rotation_flip": 0.0032375557348132133,
      "sparse_tokens": 32105.0,
      "step": 5401,
      "turn_loss": 0.11870338022708893,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.25097565508269837,
      "grad_norm": 0.37846457958221436,
      "learning_rate": 5.866938726340853e-06,
      "loss": 0.0838,
      "mae_dtheta": 0.041977666318416595,
      "mae_dx": 0.013344833627343178,
      "mae_dy": 0.004400809295475483,
      "pose_mae_dtheta": 0.36048364639282227,
      "pose_mae_dx": 0.10510583966970444,
      "pose_mae_dy": 0.03673984482884407,
      "pose_rmse_dtheta": 0.6307690739631653,
      "pose_rmse_dx": 0.22891812026500702,
      "pose_rmse_dy": 0.10360898077487946,
      "pose_rmse_mean": 0.3210987448692322,
      "rmse_dtheta": 0.06472135335206985,
      "rmse_dx": 0.025211704894900322,
      "rmse_dy": 0.011056564748287201,
      "rmse_mean": 0.03366320952773094,
      "rotation_flip": 0.009049774147570133,
      "sparse_tokens": 7846.0,
      "step": 5402,
      "turn_loss": 0.2969653010368347,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.25102211484854114,
      "grad_norm": 0.490345299243927,
      "learning_rate": 5.865636503721565e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.009207719005644321,
      "mae_dx": 0.0018589956453070045,
      "mae_dy": 0.0025100423954427242,
      "pose_mae_dtheta": 0.06547750532627106,
      "pose_mae_dx": 0.02380569837987423,
      "pose_mae_dy": 0.024097653105854988,
      "pose_rmse_dtheta": 0.18878968060016632,
      "pose_rmse_dx": 0.08066367357969284,
      "pose_rmse_dy": 0.06339193880558014,
      "pose_rmse_mean": 0.11094842851161957,
      "rmse_dtheta": 0.021011028438806534,
      "rmse_dx": 0.005548274144530296,
      "rmse_dy": 0.008087231777608395,
      "rmse_mean": 0.0115488450974226,
      "rotation_flip": 0.0029906542040407658,
      "sparse_tokens": 32121.0,
      "step": 5403,
      "turn_loss": 0.08624415844678879,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2510685746143839,
      "grad_norm": 0.38819509744644165,
      "learning_rate": 5.864334220567851e-06,
      "loss": 0.0841,
      "mae_dtheta": 0.006363223772495985,
      "mae_dx": 0.0013404886703938246,
      "mae_dy": 0.001424793736077845,
      "pose_mae_dtheta": 0.04504695162177086,
      "pose_mae_dx": 0.010422728955745697,
      "pose_mae_dy": 0.013818158768117428,
      "pose_rmse_dtheta": 0.14529551565647125,
      "pose_rmse_dx": 0.025876399129629135,
      "pose_rmse_dy": 0.03136817738413811,
      "pose_rmse_mean": 0.0675133690237999,
      "rmse_dtheta": 0.018638338893651962,
      "rmse_dx": 0.00464975880458951,
      "rmse_dy": 0.0052344584837555885,
      "rmse_mean": 0.009507518261671066,
      "rotation_flip": 0.004143646452575922,
      "sparse_tokens": 32153.0,
      "step": 5404,
      "turn_loss": 0.06348969042301178,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.2511150343802267,
      "grad_norm": 1.5836138725280762,
      "learning_rate": 5.8630318769707815e-06,
      "loss": 0.2808,
      "mae_dtheta": 0.0304762851446867,
      "mae_dx": 0.010652849450707436,
      "mae_dy": 0.004280674271285534,
      "pose_mae_dtheta": 0.25018763542175293,
      "pose_mae_dx": 0.09774062037467957,
      "pose_mae_dy": 0.0568293035030365,
      "pose_rmse_dtheta": 0.42779821157455444,
      "pose_rmse_dx": 0.23013006150722504,
      "pose_rmse_dy": 0.1469261795282364,
      "pose_rmse_mean": 0.2682848274707794,
      "rmse_dtheta": 0.04612301290035248,
      "rmse_dx": 0.023322897031903267,
      "rmse_dy": 0.009304814971983433,
      "rmse_mean": 0.026250241324305534,
      "rotation_flip": 0.012048192322254181,
      "sparse_tokens": 15586.0,
      "step": 5405,
      "turn_loss": 0.28516238927841187,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.25116149414606953,
      "grad_norm": 0.40278300642967224,
      "learning_rate": 5.861729473021429e-06,
      "loss": 0.1492,
      "mae_dtheta": 0.008907493203878403,
      "mae_dx": 0.0017210155492648482,
      "mae_dy": 0.002810731530189514,
      "pose_mae_dtheta": 0.06052882969379425,
      "pose_mae_dx": 0.023288827389478683,
      "pose_mae_dy": 0.027684269472956657,
      "pose_rmse_dtheta": 0.15472888946533203,
      "pose_rmse_dx": 0.06168319284915924,
      "pose_rmse_dy": 0.0648823156952858,
      "pose_rmse_mean": 0.09376480430364609,
      "rmse_dtheta": 0.020064061507582664,
      "rmse_dx": 0.0047540306113660336,
      "rmse_dy": 0.006068031303584576,
      "rmse_mean": 0.010295375250279903,
      "rotation_flip": 0.0012295081978663802,
      "sparse_tokens": 32073.0,
      "step": 5406,
      "turn_loss": 0.0742291510105133,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.2512079539119123,
      "grad_norm": 0.5579987168312073,
      "learning_rate": 5.860427008810872e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.03367287293076515,
      "mae_dx": 0.007708316668868065,
      "mae_dy": 0.004800537601113319,
      "pose_mae_dtheta": 0.25795644521713257,
      "pose_mae_dx": 0.06379909068346024,
      "pose_mae_dy": 0.046467483043670654,
      "pose_rmse_dtheta": 0.5281327366828918,
      "pose_rmse_dx": 0.15496215224266052,
      "pose_rmse_dy": 0.11595003306865692,
      "pose_rmse_mean": 0.26634830236434937,
      "rmse_dtheta": 0.05551804602146149,
      "rmse_dx": 0.017965354025363922,
      "rmse_dy": 0.010138173587620258,
      "rmse_mean": 0.02787385880947113,
      "rotation_flip": 0.013636363670229912,
      "sparse_tokens": 14919.0,
      "step": 5407,
      "turn_loss": 0.22885291278362274,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2512544136777551,
      "grad_norm": 0.6945812106132507,
      "learning_rate": 5.859124484430191e-06,
      "loss": 0.1653,
      "mae_dtheta": 0.0069907307624816895,
      "mae_dx": 0.0012960172025486827,
      "mae_dy": 0.0010680354898795485,
      "pose_mae_dtheta": 0.044960565865039825,
      "pose_mae_dx": 0.016400352120399475,
      "pose_mae_dy": 0.014233746565878391,
      "pose_rmse_dtheta": 0.1585608869791031,
      "pose_rmse_dx": 0.04695448279380798,
      "pose_rmse_dy": 0.036340631544589996,
      "pose_rmse_mean": 0.08061867207288742,
      "rmse_dtheta": 0.02039378508925438,
      "rmse_dx": 0.004925859626382589,
      "rmse_dy": 0.0025814927648752928,
      "rmse_mean": 0.00930037908256054,
      "rotation_flip": 0.0005181347369216383,
      "sparse_tokens": 32105.0,
      "step": 5408,
      "turn_loss": 0.05203479155898094,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.25130087344359786,
      "grad_norm": 0.3835527002811432,
      "learning_rate": 5.857821899970475e-06,
      "loss": 0.0707,
      "mae_dtheta": 0.012075116857886314,
      "mae_dx": 0.0015086712082847953,
      "mae_dy": 0.002746911719441414,
      "pose_mae_dtheta": 0.08451228588819504,
      "pose_mae_dx": 0.019178636372089386,
      "pose_mae_dy": 0.03193835914134979,
      "pose_rmse_dtheta": 0.2131662666797638,
      "pose_rmse_dx": 0.04642452299594879,
      "pose_rmse_dy": 0.0684872418642044,
      "pose_rmse_mean": 0.10935934633016586,
      "rmse_dtheta": 0.024841109290719032,
      "rmse_dx": 0.0042938231490552425,
      "rmse_dy": 0.006069549359381199,
      "rmse_mean": 0.011734827421605587,
      "rotation_flip": 0.006405933760106564,
      "sparse_tokens": 32137.0,
      "step": 5409,
      "turn_loss": 0.08675272017717361,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.25134733320944064,
      "grad_norm": 0.3553163707256317,
      "learning_rate": 5.856519255522813e-06,
      "loss": 0.0867,
      "mae_dtheta": 0.029353827238082886,
      "mae_dx": 0.008182177320122719,
      "mae_dy": 0.002302732551470399,
      "pose_mae_dtheta": 0.2273944467306137,
      "pose_mae_dx": 0.058707259595394135,
      "pose_mae_dy": 0.023946721106767654,
      "pose_rmse_dtheta": 0.4361192286014557,
      "pose_rmse_dx": 0.1704111099243164,
      "pose_rmse_dy": 0.053705278784036636,
      "pose_rmse_mean": 0.22007852792739868,
      "rmse_dtheta": 0.05009117349982262,
      "rmse_dx": 0.019367774948477745,
      "rmse_dy": 0.0051295021548867226,
      "rmse_mean": 0.02486281655728817,
      "rotation_flip": 0.01610017940402031,
      "sparse_tokens": 9705.0,
      "step": 5410,
      "turn_loss": 0.20287056267261505,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.2513937929752834,
      "grad_norm": 0.4102153778076172,
      "learning_rate": 5.8552165511783e-06,
      "loss": 0.11,
      "mae_dtheta": 0.007833780720829964,
      "mae_dx": 0.001663725357502699,
      "mae_dy": 0.0015011156210675836,
      "pose_mae_dtheta": 0.051909685134887695,
      "pose_mae_dx": 0.01728910580277443,
      "pose_mae_dy": 0.016458958387374878,
      "pose_rmse_dtheta": 0.13263577222824097,
      "pose_rmse_dx": 0.046304021030664444,
      "pose_rmse_dy": 0.043805330991744995,
      "pose_rmse_mean": 0.07424837350845337,
      "rmse_dtheta": 0.019809454679489136,
      "rmse_dx": 0.004673961084336042,
      "rmse_dy": 0.003857220523059368,
      "rmse_mean": 0.009446879848837852,
      "rotation_flip": 0.0007773027755320072,
      "sparse_tokens": 32201.0,
      "step": 5411,
      "turn_loss": 0.06249631941318512,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.2514402527411262,
      "grad_norm": 0.6991940140724182,
      "learning_rate": 5.853913787028035e-06,
      "loss": 0.1486,
      "mae_dtheta": 0.038874153047800064,
      "mae_dx": 0.014609649777412415,
      "mae_dy": 0.007072229404002428,
      "pose_mae_dtheta": 0.3072205185890198,
      "pose_mae_dx": 0.10359925776720047,
      "pose_mae_dy": 0.0840587466955185,
      "pose_rmse_dtheta": 0.5797465443611145,
      "pose_rmse_dx": 0.2149430811405182,
      "pose_rmse_dy": 0.24307246506214142,
      "pose_rmse_mean": 0.34592074155807495,
      "rmse_dtheta": 0.058529336005449295,
      "rmse_dx": 0.026721511036157608,
      "rmse_dy": 0.017400730401277542,
      "rmse_mean": 0.034217193722724915,
      "rotation_flip": 0.015424164943397045,
      "sparse_tokens": 7432.0,
      "step": 5412,
      "turn_loss": 0.2778744399547577,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.25148671250696897,
      "grad_norm": 0.4306846559047699,
      "learning_rate": 5.85261096316312e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.03435884788632393,
      "mae_dx": 0.015318673104047775,
      "mae_dy": 0.007569970563054085,
      "pose_mae_dtheta": 0.24527506530284882,
      "pose_mae_dx": 0.10285257548093796,
      "pose_mae_dy": 0.09144353866577148,
      "pose_rmse_dtheta": 0.3915014863014221,
      "pose_rmse_dx": 0.23165592551231384,
      "pose_rmse_dy": 0.20111693441867828,
      "pose_rmse_mean": 0.27475810050964355,
      "rmse_dtheta": 0.04780043661594391,
      "rmse_dx": 0.02934405207633972,
      "rmse_dy": 0.014364627189934254,
      "rmse_mean": 0.030503040179610252,
      "rotation_flip": 0.0065645514987409115,
      "sparse_tokens": 6895.0,
      "step": 5413,
      "turn_loss": 0.29405784606933594,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.25153317227281174,
      "grad_norm": 0.4655250608921051,
      "learning_rate": 5.851308079674662e-06,
      "loss": 0.0724,
      "mae_dtheta": 0.03664350509643555,
      "mae_dx": 0.012948031537234783,
      "mae_dy": 0.0035156465601176023,
      "pose_mae_dtheta": 0.2831078767776489,
      "pose_mae_dx": 0.08922699838876724,
      "pose_mae_dy": 0.05993494391441345,
      "pose_rmse_dtheta": 0.5575743317604065,
      "pose_rmse_dx": 0.21861805021762848,
      "pose_rmse_dy": 0.17040979862213135,
      "pose_rmse_mean": 0.3155340552330017,
      "rmse_dtheta": 0.05851835384964943,
      "rmse_dx": 0.026899145916104317,
      "rmse_dy": 0.00710289366543293,
      "rmse_mean": 0.030840132385492325,
      "rotation_flip": 0.0037174720782786608,
      "sparse_tokens": 4787.0,
      "step": 5414,
      "turn_loss": 0.25005903840065,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2515796320386545,
      "grad_norm": 0.6615725755691528,
      "learning_rate": 5.850005136653774e-06,
      "loss": 0.0921,
      "mae_dtheta": 0.006702318321913481,
      "mae_dx": 0.0017277142032980919,
      "mae_dy": 0.0008890223107300699,
      "pose_mae_dtheta": 0.0485745407640934,
      "pose_mae_dx": 0.016348181292414665,
      "pose_mae_dy": 0.011250478215515614,
      "pose_rmse_dtheta": 0.14188562333583832,
      "pose_rmse_dx": 0.04275406897068024,
      "pose_rmse_dy": 0.028903650119900703,
      "pose_rmse_mean": 0.07118111848831177,
      "rmse_dtheta": 0.018801085650920868,
      "rmse_dx": 0.005173115525394678,
      "rmse_dy": 0.0019261237466707826,
      "rmse_mean": 0.008633442223072052,
      "rotation_flip": 0.00291686924174428,
      "sparse_tokens": 32185.0,
      "step": 5415,
      "turn_loss": 0.049575161188840866,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2516260918044973,
      "grad_norm": 0.3563266098499298,
      "learning_rate": 5.848702134191571e-06,
      "loss": 0.0779,
      "mae_dtheta": 0.007710547186434269,
      "mae_dx": 0.00187678390648216,
      "mae_dy": 0.0022490774281322956,
      "pose_mae_dtheta": 0.05712471157312393,
      "pose_mae_dx": 0.020817389711737633,
      "pose_mae_dy": 0.024429570883512497,
      "pose_rmse_dtheta": 0.13132339715957642,
      "pose_rmse_dx": 0.05686988681554794,
      "pose_rmse_dy": 0.059761278331279755,
      "pose_rmse_mean": 0.0826515257358551,
      "rmse_dtheta": 0.01783829927444458,
      "rmse_dx": 0.005560177844017744,
      "rmse_dy": 0.005284014157950878,
      "rmse_mean": 0.009560830891132355,
      "rotation_flip": 0.0039595249108970165,
      "sparse_tokens": 32089.0,
      "step": 5416,
      "turn_loss": 0.07169209420681,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2516725515703401,
      "grad_norm": 0.5164154171943665,
      "learning_rate": 5.847399072379171e-06,
      "loss": 0.109,
      "mae_dtheta": 0.011297558434307575,
      "mae_dx": 0.0019777968991547823,
      "mae_dy": 0.00276666646823287,
      "pose_mae_dtheta": 0.07474783807992935,
      "pose_mae_dx": 0.02724638395011425,
      "pose_mae_dy": 0.0362807922065258,
      "pose_rmse_dtheta": 0.14222581684589386,
      "pose_rmse_dx": 0.06341122835874557,
      "pose_rmse_dy": 0.07729239761829376,
      "pose_rmse_mean": 0.09430980682373047,
      "rmse_dtheta": 0.020382972434163094,
      "rmse_dx": 0.006021648645401001,
      "rmse_dy": 0.0051779476925730705,
      "rmse_mean": 0.01052752323448658,
      "rotation_flip": 0.0043933759443461895,
      "sparse_tokens": 32105.0,
      "step": 5417,
      "turn_loss": 0.09418787807226181,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.25171901133618285,
      "grad_norm": 0.3709268569946289,
      "learning_rate": 5.8460959513077e-06,
      "loss": 0.0727,
      "mae_dtheta": 0.007232030853629112,
      "mae_dx": 0.0013770062942057848,
      "mae_dy": 0.0005291035049594939,
      "pose_mae_dtheta": 0.053388699889183044,
      "pose_mae_dx": 0.010818668641149998,
      "pose_mae_dy": 0.007614211179316044,
      "pose_rmse_dtheta": 0.2045290619134903,
      "pose_rmse_dx": 0.024208368733525276,
      "pose_rmse_dy": 0.02541700191795826,
      "pose_rmse_mean": 0.08471815288066864,
      "rmse_dtheta": 0.024950914084911346,
      "rmse_dx": 0.0036750235594809055,
      "rmse_dy": 0.001398672116920352,
      "rmse_mean": 0.010008202865719795,
      "rotation_flip": 0.0025471218395978212,
      "sparse_tokens": 32233.0,
      "step": 5418,
      "turn_loss": 0.045871295034885406,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.25176547110202563,
      "grad_norm": 0.5053687691688538,
      "learning_rate": 5.844792771068284e-06,
      "loss": 0.0715,
      "mae_dtheta": 0.010658233426511288,
      "mae_dx": 0.002066137036308646,
      "mae_dy": 0.0037808571942150593,
      "pose_mae_dtheta": 0.07726644724607468,
      "pose_mae_dx": 0.03138956427574158,
      "pose_mae_dy": 0.0378350093960762,
      "pose_rmse_dtheta": 0.17231695353984833,
      "pose_rmse_dx": 0.08008329570293427,
      "pose_rmse_dy": 0.10973946005105972,
      "pose_rmse_mean": 0.1207132339477539,
      "rmse_dtheta": 0.021389616653323174,
      "rmse_dx": 0.005365334451198578,
      "rmse_dy": 0.008872969076037407,
      "rmse_mean": 0.011875974014401436,
      "rotation_flip": 0.005104043986648321,
      "sparse_tokens": 32073.0,
      "step": 5419,
      "turn_loss": 0.09238357841968536,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2518119308678684,
      "grad_norm": 0.48297378420829773,
      "learning_rate": 5.843489531752057e-06,
      "loss": 0.1085,
      "mae_dtheta": 0.010456429794430733,
      "mae_dx": 0.0017757592722773552,
      "mae_dy": 0.0021584194619208574,
      "pose_mae_dtheta": 0.07183140516281128,
      "pose_mae_dx": 0.025989489629864693,
      "pose_mae_dy": 0.028985721990466118,
      "pose_rmse_dtheta": 0.17766377329826355,
      "pose_rmse_dx": 0.06995567679405212,
      "pose_rmse_dy": 0.0732419416308403,
      "pose_rmse_mean": 0.10695379972457886,
      "rmse_dtheta": 0.023030810058116913,
      "rmse_dx": 0.00611436041072011,
      "rmse_dy": 0.0049730390310287476,
      "rmse_mean": 0.011372736655175686,
      "rotation_flip": 0.003874091897159815,
      "sparse_tokens": 32041.0,
      "step": 5420,
      "turn_loss": 0.07550821453332901,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.2518583906337112,
      "grad_norm": 0.4915006160736084,
      "learning_rate": 5.842186233450153e-06,
      "loss": 0.1175,
      "mae_dtheta": 0.018102042376995087,
      "mae_dx": 0.004771880339831114,
      "mae_dy": 0.002539796754717827,
      "pose_mae_dtheta": 0.14090850949287415,
      "pose_mae_dx": 0.04520639404654503,
      "pose_mae_dy": 0.0323878675699234,
      "pose_rmse_dtheta": 0.35413724184036255,
      "pose_rmse_dx": 0.12036971747875214,
      "pose_rmse_dy": 0.09420321136713028,
      "pose_rmse_mean": 0.18957006931304932,
      "rmse_dtheta": 0.03872751072049141,
      "rmse_dx": 0.013394724577665329,
      "rmse_dy": 0.0075898244976997375,
      "rmse_mean": 0.01990402117371559,
      "rotation_flip": 0.0041135335341095924,
      "sparse_tokens": 32249.0,
      "step": 5421,
      "turn_loss": 0.14309963583946228,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4239.0,
      "epoch": 0.25190485039955396,
      "grad_norm": 0.5483091473579407,
      "learning_rate": 5.840882876253715e-06,
      "loss": 0.0889,
      "mae_dtheta": 0.034263115376234055,
      "mae_dx": 0.015154343098402023,
      "mae_dy": 0.0064633749425411224,
      "pose_mae_dtheta": 0.2875404953956604,
      "pose_mae_dx": 0.14035090804100037,
      "pose_mae_dy": 0.08902986347675323,
      "pose_rmse_dtheta": 0.49826550483703613,
      "pose_rmse_dx": 0.31344515085220337,
      "pose_rmse_dy": 0.1581762433052063,
      "pose_rmse_mean": 0.3232956528663635,
      "rmse_dtheta": 0.04936595261096954,
      "rmse_dx": 0.03038131818175316,
      "rmse_dy": 0.009281440638005733,
      "rmse_mean": 0.02967623993754387,
      "rotation_flip": 0.0,
      "sparse_tokens": 3310.0,
      "step": 5422,
      "turn_loss": 0.29156070947647095,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2519513101653968,
      "grad_norm": 0.5250966548919678,
      "learning_rate": 5.839579460253887e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.0079346327111125,
      "mae_dx": 0.0012744168052449822,
      "mae_dy": 0.0019010191317647696,
      "pose_mae_dtheta": 0.053946249186992645,
      "pose_mae_dx": 0.01799030229449272,
      "pose_mae_dy": 0.024767324328422546,
      "pose_rmse_dtheta": 0.12001249194145203,
      "pose_rmse_dx": 0.044692616909742355,
      "pose_rmse_dy": 0.057269398123025894,
      "pose_rmse_mean": 0.07399150729179382,
      "rmse_dtheta": 0.017743468284606934,
      "rmse_dx": 0.0036360654048621655,
      "rmse_dy": 0.004175347741693258,
      "rmse_mean": 0.008518294431269169,
      "rotation_flip": 0.003748438088223338,
      "sparse_tokens": 32089.0,
      "step": 5423,
      "turn_loss": 0.07229678332805634,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.25199776993123957,
      "grad_norm": 0.6625094413757324,
      "learning_rate": 5.838275985541815e-06,
      "loss": 0.1839,
      "mae_dtheta": 0.036538124084472656,
      "mae_dx": 0.009763067588210106,
      "mae_dy": 0.0070564839988946915,
      "pose_mae_dtheta": 0.34076061844825745,
      "pose_mae_dx": 0.04139428958296776,
      "pose_mae_dy": 0.043996162712574005,
      "pose_rmse_dtheta": 0.5877684950828552,
      "pose_rmse_dx": 0.08480041474103928,
      "pose_rmse_dy": 0.11381175369024277,
      "pose_rmse_mean": 0.2621268928050995,
      "rmse_dtheta": 0.058810967952013016,
      "rmse_dx": 0.020288506522774696,
      "rmse_dy": 0.017385324463248253,
      "rmse_mean": 0.03216160088777542,
      "rotation_flip": 0.01034482754766941,
      "sparse_tokens": 4412.0,
      "step": 5424,
      "turn_loss": 0.35410767793655396,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.25204422969708234,
      "grad_norm": 1.2481975555419922,
      "learning_rate": 5.8369724522086545e-06,
      "loss": 0.2537,
      "mae_dtheta": 0.035783588886260986,
      "mae_dx": 0.01747776009142399,
      "mae_dy": 0.006371921394020319,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999993443489075,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 131.91741943359375,
      "model/head/act_norm_mean": 107.48570667613636,
      "model/head/act_norm_min": 64.75324249267578,
      "model/head/act_over_embed": 73.86518392488128,
      "model/head/grad_frac": 0.09830104559659958,
      "model/head/grad_norm": 0.0983009785413742,
      "model/head/grad_zero_frac": 0.0002062266576103866,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7001953125,
      "model/head/update_ratio": 0.0016817973228171468,
      "model/head/weight_delta": 8.58510684967041,
      "model/head/weight_delta_rel": 0.15060819685459137,
      "model/head/weight_norm": 58.449954986572266,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4204263985157013,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42038287287173065,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42032381892204285,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2888910459239169,
      "model/modality_embedder.encoders.pose/grad_frac": 0.14761978387832642,
      "model/modality_embedder.encoders.pose/grad_norm": 0.14761969447135925,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5463654891304348,
      "model/modality_embedder.encoders.pose/update_ratio": 0.004773393739014864,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8036231994628906,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0916031077504158,
      "model/modality_embedder.encoders.pose/weight_norm": 30.92552375793457,
      "model/modality_embedder/grad_frac": 0.14761978387832642,
      "model/modality_embedder/grad_norm": 0.14761969447135925,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5463654891304348,
      "model/modality_embedder/update_ratio": 0.004773393739014864,
      "model/modality_embedder/weight_delta": 2.8036231994628906,
      "model/modality_embedder/weight_delta_rel": 0.0916031077504158,
      "model/modality_embedder/weight_norm": 30.92552375793457,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.28999328613281,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.332679473304474,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.15603256225586,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.034435778041704,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08126218616962433,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.08126213401556015,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0029196678660809994,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.145829200744629,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07819531112909317,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.832664489746094,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.5839614868164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.12085137085137,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.69741153717041,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.576074885017494,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07730589061975479,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07730583846569061,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0026153961662203074,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.7184951305389404,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09417079389095306,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.5579833984375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.06700134277344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.675290854978353,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.90262222290039,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.644300251401294,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08546024560928345,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.08546018600463867,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00033287605037912726,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0028005403000861406,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.9263737201690674,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09826215356588364,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.515605926513672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.41364288330078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.6300110479798,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.014867782592773,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.98760226841066,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07922746241092682,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07922741025686264,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0026598316617310047,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.499282121658325,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0854136049747467,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.786624908447266,
      "model/normalizer/grad_frac": 0.32621073722839355,
      "model/normalizer/grad_norm": 0.32621052861213684,
      "model/normalizer/grad_zero_frac": 0.0002753450535237789,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004159802570939064,
      "model/normalizer/weight_delta": 5.298084735870361,
      "model/normalizer/weight_delta_rel": 0.06823626160621643,
      "model/normalizer/weight_norm": 78.41971588134766,
      "pose_mae_dtheta": 0.2481183409690857,
      "pose_mae_dx": 0.12898074090480804,
      "pose_mae_dy": 0.10656872391700745,
      "pose_rmse_dtheta": 0.3673596680164337,
      "pose_rmse_dx": 0.2716694474220276,
      "pose_rmse_dy": 0.20627152919769287,
      "pose_rmse_mean": 0.2817668914794922,
      "rmse_dtheta": 0.04930289834737778,
      "rmse_dx": 0.032202381640672684,
      "rmse_dy": 0.010008787736296654,
      "rmse_mean": 0.03050469234585762,
      "rotation_flip": 0.019662922248244286,
      "sparse_tokens": 5956.0,
      "step": 5425,
      "turn_loss": 0.3180069625377655,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.2520906894629251,
      "grad_norm": 0.5676698088645935,
      "learning_rate": 5.835668860345561e-06,
      "loss": 0.1214,
      "mae_dtheta": 0.031024880707263947,
      "mae_dx": 0.010429716669023037,
      "mae_dy": 0.004488945472985506,
      "pose_mae_dtheta": 0.22919410467147827,
      "pose_mae_dx": 0.07928387075662613,
      "pose_mae_dy": 0.04679107666015625,
      "pose_rmse_dtheta": 0.41855737566947937,
      "pose_rmse_dx": 0.17034228146076202,
      "pose_rmse_dy": 0.11651536077260971,
      "pose_rmse_mean": 0.23513834178447723,
      "rmse_dtheta": 0.04838317632675171,
      "rmse_dx": 0.021024160087108612,
      "rmse_dy": 0.009777787141501904,
      "rmse_mean": 0.0263950414955616,
      "rotation_flip": 0.017446471378207207,
      "sparse_tokens": 19804.0,
      "step": 5426,
      "turn_loss": 0.24140945076942444,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2521371492287679,
      "grad_norm": 0.5391241312026978,
      "learning_rate": 5.8343652100436936e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.014051085337996483,
      "mae_dx": 0.0022738738916814327,
      "mae_dy": 0.0038466015830636024,
      "pose_mae_dtheta": 0.09497568756341934,
      "pose_mae_dx": 0.03126700967550278,
      "pose_mae_dy": 0.03949638828635216,
      "pose_rmse_dtheta": 0.20516254007816315,
      "pose_rmse_dx": 0.07412774860858917,
      "pose_rmse_dy": 0.09589938074350357,
      "pose_rmse_mean": 0.1250632256269455,
      "rmse_dtheta": 0.02634284272789955,
      "rmse_dx": 0.00623727310448885,
      "rmse_dy": 0.008011671714484692,
      "rmse_mean": 0.013530596159398556,
      "rotation_flip": 0.009162303991615772,
      "sparse_tokens": 32089.0,
      "step": 5427,
      "turn_loss": 0.13178494572639465,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.2521836089946107,
      "grad_norm": 0.6926059126853943,
      "learning_rate": 5.83306150139422e-06,
      "loss": 0.2092,
      "mae_dtheta": 0.037970177829265594,
      "mae_dx": 0.016055529937148094,
      "mae_dy": 0.005004111677408218,
      "pose_mae_dtheta": 0.30459871888160706,
      "pose_mae_dx": 0.13936223089694977,
      "pose_mae_dy": 0.06080367788672447,
      "pose_rmse_dtheta": 0.4850305914878845,
      "pose_rmse_dx": 0.29943519830703735,
      "pose_rmse_dy": 0.12781259417533875,
      "pose_rmse_mean": 0.3040928244590759,
      "rmse_dtheta": 0.05354035273194313,
      "rmse_dx": 0.03059709072113037,
      "rmse_dy": 0.009113367646932602,
      "rmse_mean": 0.03108360432088375,
      "rotation_flip": 0.02043132856488228,
      "sparse_tokens": 15356.0,
      "step": 5428,
      "turn_loss": 0.298594206571579,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.25223006876045345,
      "grad_norm": 0.4966426193714142,
      "learning_rate": 5.83175773448831e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.03340235352516174,
      "mae_dx": 0.013074026443064213,
      "mae_dy": 0.00547028286382556,
      "pose_mae_dtheta": 0.23624873161315918,
      "pose_mae_dx": 0.10636445879936218,
      "pose_mae_dy": 0.06788428872823715,
      "pose_rmse_dtheta": 0.42673543095588684,
      "pose_rmse_dx": 0.24404627084732056,
      "pose_rmse_dy": 0.1564342975616455,
      "pose_rmse_mean": 0.2757386863231659,
      "rmse_dtheta": 0.05149595066905022,
      "rmse_dx": 0.026300404220819473,
      "rmse_dy": 0.010577594861388206,
      "rmse_mean": 0.02945798449218273,
      "rotation_flip": 0.008896796964108944,
      "sparse_tokens": 9227.0,
      "step": 5429,
      "turn_loss": 0.3075234591960907,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.25227652852629623,
      "grad_norm": 1.2855019569396973,
      "learning_rate": 5.830453909417136e-06,
      "loss": 0.2747,
      "mae_dtheta": 0.03296516090631485,
      "mae_dx": 0.01134432852268219,
      "mae_dy": 0.0060380855575203896,
      "pose_mae_dtheta": 0.2551772892475128,
      "pose_mae_dx": 0.09707868844270706,
      "pose_mae_dy": 0.05823327600955963,
      "pose_rmse_dtheta": 0.42762964963912964,
      "pose_rmse_dx": 0.18686717748641968,
      "pose_rmse_dy": 0.15030717849731445,
      "pose_rmse_mean": 0.2549346685409546,
      "rmse_dtheta": 0.048737745732069016,
      "rmse_dx": 0.022235404700040817,
      "rmse_dy": 0.011534285731613636,
      "rmse_mean": 0.027502480894327164,
      "rotation_flip": 0.009756097570061684,
      "sparse_tokens": 7080.0,
      "step": 5430,
      "turn_loss": 0.29126283526420593,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.252322988292139,
      "grad_norm": 0.7030647397041321,
      "learning_rate": 5.829150026271871e-06,
      "loss": 0.1671,
      "mae_dtheta": 0.027974193915724754,
      "mae_dx": 0.00894849468022585,
      "mae_dy": 0.004571689758449793,
      "pose_mae_dtheta": 0.21016915142536163,
      "pose_mae_dx": 0.06631634384393692,
      "pose_mae_dy": 0.04920187219977379,
      "pose_rmse_dtheta": 0.4511045217514038,
      "pose_rmse_dx": 0.1841026097536087,
      "pose_rmse_dy": 0.11758885532617569,
      "pose_rmse_mean": 0.2509320080280304,
      "rmse_dtheta": 0.048566367477178574,
      "rmse_dx": 0.02070329524576664,
      "rmse_dy": 0.01150961872190237,
      "rmse_mean": 0.026926428079605103,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 10030.0,
      "step": 5431,
      "turn_loss": 0.1912202090024948,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 5547.0,
      "epoch": 0.2523694480579818,
      "grad_norm": 0.8339229822158813,
      "learning_rate": 5.827846085143702e-06,
      "loss": 0.1112,
      "mae_dtheta": 0.041921667754650116,
      "mae_dx": 0.00865389034152031,
      "mae_dy": 0.010898041538894176,
      "pose_mae_dtheta": 0.35188281536102295,
      "pose_mae_dx": 0.09890545159578323,
      "pose_mae_dy": 0.0739092230796814,
      "pose_rmse_dtheta": 0.6378600597381592,
      "pose_rmse_dx": 0.20545992255210876,
      "pose_rmse_dy": 0.16783271729946136,
      "pose_rmse_mean": 0.3370509147644043,
      "rmse_dtheta": 0.06396327167749405,
      "rmse_dx": 0.018775267526507378,
      "rmse_dy": 0.022960279136896133,
      "rmse_mean": 0.035232942551374435,
      "rotation_flip": 0.009999999776482582,
      "sparse_tokens": 4971.0,
      "step": 5432,
      "turn_loss": 0.40595299005508423,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.25241590782382456,
      "grad_norm": 1.040181040763855,
      "learning_rate": 5.826542086123812e-06,
      "loss": 0.2505,
      "mae_dtheta": 0.02833487093448639,
      "mae_dx": 0.006677067838609219,
      "mae_dy": 0.003220384009182453,
      "pose_mae_dtheta": 0.21951407194137573,
      "pose_mae_dx": 0.045938991010189056,
      "pose_mae_dy": 0.03147171065211296,
      "pose_rmse_dtheta": 0.4349842965602875,
      "pose_rmse_dx": 0.09905516356229782,
      "pose_rmse_dy": 0.0855179950594902,
      "pose_rmse_mean": 0.20651915669441223,
      "rmse_dtheta": 0.0479053258895874,
      "rmse_dx": 0.014239470474421978,
      "rmse_dy": 0.008715111762285233,
      "rmse_mean": 0.023619970306754112,
      "rotation_flip": 0.011152416467666626,
      "sparse_tokens": 4525.0,
      "step": 5433,
      "turn_loss": 0.15684080123901367,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.25246236758966734,
      "grad_norm": 0.6448842287063599,
      "learning_rate": 5.825238029303388e-06,
      "loss": 0.1406,
      "mae_dtheta": 0.035814929753541946,
      "mae_dx": 0.010185977444052696,
      "mae_dy": 0.005513270851224661,
      "pose_mae_dtheta": 0.27846136689186096,
      "pose_mae_dx": 0.08351370692253113,
      "pose_mae_dy": 0.07619216293096542,
      "pose_rmse_dtheta": 0.5299803018569946,
      "pose_rmse_dx": 0.16480191051959991,
      "pose_rmse_dy": 0.16432681679725647,
      "pose_rmse_mean": 0.2863696813583374,
      "rmse_dtheta": 0.05765339359641075,
      "rmse_dx": 0.02143588475883007,
      "rmse_dy": 0.010404631495475769,
      "rmse_mean": 0.029831303283572197,
      "rotation_flip": 0.015552099794149399,
      "sparse_tokens": 11926.0,
      "step": 5434,
      "turn_loss": 0.296202689409256,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2525088273555101,
      "grad_norm": 0.5718143582344055,
      "learning_rate": 5.823933914773628e-06,
      "loss": 0.1618,
      "mae_dtheta": 0.009805395267903805,
      "mae_dx": 0.0015997989103198051,
      "mae_dy": 0.002247898606583476,
      "pose_mae_dtheta": 0.06102732941508293,
      "pose_mae_dx": 0.021414240822196007,
      "pose_mae_dy": 0.028298433870077133,
      "pose_rmse_dtheta": 0.11346990615129471,
      "pose_rmse_dx": 0.05314242094755173,
      "pose_rmse_dy": 0.05864490941166878,
      "pose_rmse_mean": 0.07508574426174164,
      "rmse_dtheta": 0.017893491312861443,
      "rmse_dx": 0.005135136656463146,
      "rmse_dy": 0.004138123709708452,
      "rmse_mean": 0.009055583737790585,
      "rotation_flip": 0.005462490953505039,
      "sparse_tokens": 32105.0,
      "step": 5435,
      "turn_loss": 0.0847196877002716,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.2525552871213529,
      "grad_norm": 0.528778076171875,
      "learning_rate": 5.822629742625726e-06,
      "loss": 0.1548,
      "mae_dtheta": 0.03690449148416519,
      "mae_dx": 0.003782275365665555,
      "mae_dy": 0.0041394541040062904,
      "pose_mae_dtheta": 0.33109161257743835,
      "pose_mae_dx": 0.04004565253853798,
      "pose_mae_dy": 0.04618190601468086,
      "pose_rmse_dtheta": 0.566308856010437,
      "pose_rmse_dx": 0.0881756916642189,
      "pose_rmse_dy": 0.08711592853069305,
      "pose_rmse_mean": 0.24720017611980438,
      "rmse_dtheta": 0.05496572330594063,
      "rmse_dx": 0.010157963261008263,
      "rmse_dy": 0.007327695842832327,
      "rmse_mean": 0.024150460958480835,
      "rotation_flip": 0.009592326357960701,
      "sparse_tokens": 6418.0,
      "step": 5436,
      "turn_loss": 0.274489164352417,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.25260174688719567,
      "grad_norm": 0.40700000524520874,
      "learning_rate": 5.821325512950886e-06,
      "loss": 0.099,
      "mae_dtheta": 0.012110762298107147,
      "mae_dx": 0.0016330922953784466,
      "mae_dy": 0.002713296562433243,
      "pose_mae_dtheta": 0.08020366728305817,
      "pose_mae_dx": 0.02305801585316658,
      "pose_mae_dy": 0.0354948453605175,
      "pose_rmse_dtheta": 0.16046753525733948,
      "pose_rmse_dx": 0.05730108916759491,
      "pose_rmse_dy": 0.08362492173910141,
      "pose_rmse_mean": 0.10046451538801193,
      "rmse_dtheta": 0.02329823561012745,
      "rmse_dx": 0.004961146041750908,
      "rmse_dy": 0.00526422169059515,
      "rmse_mean": 0.011174535378813744,
      "rotation_flip": 0.0032644178718328476,
      "sparse_tokens": 32105.0,
      "step": 5437,
      "turn_loss": 0.1066790372133255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.25264820665303844,
      "grad_norm": 0.4534832835197449,
      "learning_rate": 5.820021225840311e-06,
      "loss": 0.1063,
      "mae_dtheta": 0.008576569147408009,
      "mae_dx": 0.0014188068453222513,
      "mae_dy": 0.0014010396553203464,
      "pose_mae_dtheta": 0.057968445122241974,
      "pose_mae_dx": 0.014586813747882843,
      "pose_mae_dy": 0.01836226135492325,
      "pose_rmse_dtheta": 0.1617790162563324,
      "pose_rmse_dx": 0.035523682832717896,
      "pose_rmse_dy": 0.04972730576992035,
      "pose_rmse_mean": 0.08234333992004395,
      "rmse_dtheta": 0.021610796451568604,
      "rmse_dx": 0.004358104430139065,
      "rmse_dy": 0.0034101170022040606,
      "rmse_mean": 0.00979300681501627,
      "rotation_flip": 0.005080831237137318,
      "sparse_tokens": 32121.0,
      "step": 5438,
      "turn_loss": 0.0626554861664772,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.2526946664188813,
      "grad_norm": 0.46556246280670166,
      "learning_rate": 5.8187168813852115e-06,
      "loss": 0.1252,
      "mae_dtheta": 0.03240075707435608,
      "mae_dx": 0.010836726054549217,
      "mae_dy": 0.0060967011377215385,
      "pose_mae_dtheta": 0.261909544467926,
      "pose_mae_dx": 0.09594202041625977,
      "pose_mae_dy": 0.0718352273106575,
      "pose_rmse_dtheta": 0.44588547945022583,
      "pose_rmse_dx": 0.23973910510540009,
      "pose_rmse_dy": 0.15080812573432922,
      "pose_rmse_mean": 0.27881091833114624,
      "rmse_dtheta": 0.05085679143667221,
      "rmse_dx": 0.02464267984032631,
      "rmse_dy": 0.010464943014085293,
      "rmse_mean": 0.028654806315898895,
      "rotation_flip": 0.008495145477354527,
      "sparse_tokens": 14818.0,
      "step": 5439,
      "turn_loss": 0.30001401901245117,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 17158.0,
      "epoch": 0.25274112618472405,
      "grad_norm": 0.5777668952941895,
      "learning_rate": 5.817412479676801e-06,
      "loss": 0.1772,
      "mae_dtheta": 0.03605436906218529,
      "mae_dx": 0.010166209191083908,
      "mae_dy": 0.006123592145740986,
      "pose_mae_dtheta": 0.24874605238437653,
      "pose_mae_dx": 0.07852112501859665,
      "pose_mae_dy": 0.07455746084451675,
      "pose_rmse_dtheta": 0.4483892321586609,
      "pose_rmse_dx": 0.1838885396718979,
      "pose_rmse_dy": 0.16424043476581573,
      "pose_rmse_mean": 0.2655060887336731,
      "rmse_dtheta": 0.053315430879592896,
      "rmse_dx": 0.02253865823149681,
      "rmse_dy": 0.012685074470937252,
      "rmse_mean": 0.029513057321310043,
      "rotation_flip": 0.01246882788836956,
      "sparse_tokens": 14504.0,
      "step": 5440,
      "turn_loss": 0.299236536026001,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.25278758595056683,
      "grad_norm": 0.3986259698867798,
      "learning_rate": 5.816108020806297e-06,
      "loss": 0.0786,
      "mae_dtheta": 0.007213707081973553,
      "mae_dx": 0.0012513584224507213,
      "mae_dy": 0.0015924953622743487,
      "pose_mae_dtheta": 0.04810769483447075,
      "pose_mae_dx": 0.013356405310332775,
      "pose_mae_dy": 0.020379887893795967,
      "pose_rmse_dtheta": 0.08226318657398224,
      "pose_rmse_dx": 0.02999226376414299,
      "pose_rmse_dy": 0.04198886826634407,
      "pose_rmse_mean": 0.05141477286815643,
      "rmse_dtheta": 0.013781248591840267,
      "rmse_dx": 0.003601470496505499,
      "rmse_dy": 0.0033420033287256956,
      "rmse_mean": 0.006908240728080273,
      "rotation_flip": 0.006088825408369303,
      "sparse_tokens": 32137.0,
      "step": 5441,
      "turn_loss": 0.06054754927754402,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.2528340457164096,
      "grad_norm": 0.7316824793815613,
      "learning_rate": 5.814803504864922e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.006816977635025978,
      "mae_dx": 0.001295517897233367,
      "mae_dy": 0.00023406372929457575,
      "pose_mae_dtheta": 0.04915641248226166,
      "pose_mae_dx": 0.010598589666187763,
      "pose_mae_dy": 0.0030298950150609016,
      "pose_rmse_dtheta": 0.23963117599487305,
      "pose_rmse_dx": 0.028555091470479965,
      "pose_rmse_dy": 0.005790798459202051,
      "pose_rmse_mean": 0.09132569283246994,
      "rmse_dtheta": 0.028146272525191307,
      "rmse_dx": 0.0038095221389085054,
      "rmse_dy": 0.0005086238379590213,
      "rmse_mean": 0.010821472853422165,
      "rotation_flip": 0.0006561679765582085,
      "sparse_tokens": 32201.0,
      "step": 5442,
      "turn_loss": 0.048191532492637634,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2528805054822524,
      "grad_norm": 0.421458899974823,
      "learning_rate": 5.8134989319439004e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.01214597001671791,
      "mae_dx": 0.0028192917816340923,
      "mae_dy": 0.004358378238976002,
      "pose_mae_dtheta": 0.0796816349029541,
      "pose_mae_dx": 0.04011019319295883,
      "pose_mae_dy": 0.039551228284835815,
      "pose_rmse_dtheta": 0.14974787831306458,
      "pose_rmse_dx": 0.09438206255435944,
      "pose_rmse_dy": 0.08487355709075928,
      "pose_rmse_mean": 0.1096678376197815,
      "rmse_dtheta": 0.021812528371810913,
      "rmse_dx": 0.006970028392970562,
      "rmse_dy": 0.009289508685469627,
      "rmse_mean": 0.012690688483417034,
      "rotation_flip": 0.008248102851212025,
      "sparse_tokens": 32137.0,
      "step": 5443,
      "turn_loss": 0.1291336715221405,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.25292696524809516,
      "grad_norm": 0.5443767309188843,
      "learning_rate": 5.812194302134462e-06,
      "loss": 0.1553,
      "mae_dtheta": 0.011327922344207764,
      "mae_dx": 0.001245439751073718,
      "mae_dy": 0.0020088187884539366,
      "pose_mae_dtheta": 0.07093270123004913,
      "pose_mae_dx": 0.016579654067754745,
      "pose_mae_dy": 0.024441787973046303,
      "pose_rmse_dtheta": 0.21804846823215485,
      "pose_rmse_dx": 0.03883710131049156,
      "pose_rmse_dy": 0.05585826188325882,
      "pose_rmse_mean": 0.10424794256687164,
      "rmse_dtheta": 0.02708026021718979,
      "rmse_dx": 0.003534340765327215,
      "rmse_dy": 0.004037864506244659,
      "rmse_mean": 0.011550821363925934,
      "rotation_flip": 0.005875440780073404,
      "sparse_tokens": 32105.0,
      "step": 5444,
      "turn_loss": 0.08380652219057083,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.25297342501393794,
      "grad_norm": 0.6112345457077026,
      "learning_rate": 5.810889615527839e-06,
      "loss": 0.1488,
      "mae_dtheta": 0.026087185367941856,
      "mae_dx": 0.011971622705459595,
      "mae_dy": 0.003357777139171958,
      "pose_mae_dtheta": 0.18094287812709808,
      "pose_mae_dx": 0.08806643635034561,
      "pose_mae_dy": 0.053298670798540115,
      "pose_rmse_dtheta": 0.3002007305622101,
      "pose_rmse_dx": 0.19811248779296875,
      "pose_rmse_dy": 0.15920090675354004,
      "pose_rmse_mean": 0.21917137503623962,
      "rmse_dtheta": 0.0424809493124485,
      "rmse_dx": 0.024793878197669983,
      "rmse_dy": 0.007388298399746418,
      "rmse_mean": 0.024887708947062492,
      "rotation_flip": 0.01344086043536663,
      "sparse_tokens": 6211.0,
      "step": 5445,
      "turn_loss": 0.21407102048397064,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.2530198847797807,
      "grad_norm": 0.4648803472518921,
      "learning_rate": 5.80958487221527e-06,
      "loss": 0.0913,
      "mae_dtheta": 0.03062230907380581,
      "mae_dx": 0.009254367090761662,
      "mae_dy": 0.0032362821511924267,
      "pose_mae_dtheta": 0.22629211843013763,
      "pose_mae_dx": 0.07218661904335022,
      "pose_mae_dy": 0.04803616553544998,
      "pose_rmse_dtheta": 0.4287739098072052,
      "pose_rmse_dx": 0.16298244893550873,
      "pose_rmse_dy": 0.12992547452449799,
      "pose_rmse_mean": 0.2405606210231781,
      "rmse_dtheta": 0.050227921456098557,
      "rmse_dx": 0.020959189161658287,
      "rmse_dy": 0.006697313394397497,
      "rmse_mean": 0.02596147358417511,
      "rotation_flip": 0.009271522983908653,
      "sparse_tokens": 14188.0,
      "step": 5446,
      "turn_loss": 0.20903392136096954,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2530663445456235,
      "grad_norm": 0.6834830641746521,
      "learning_rate": 5.808280072287996e-06,
      "loss": 0.1829,
      "mae_dtheta": 0.00920940563082695,
      "mae_dx": 0.0016671015182510018,
      "mae_dy": 0.002661174861714244,
      "pose_mae_dtheta": 0.05652204900979996,
      "pose_mae_dx": 0.021308165043592453,
      "pose_mae_dy": 0.0269223153591156,
      "pose_rmse_dtheta": 0.1356627196073532,
      "pose_rmse_dx": 0.051090605556964874,
      "pose_rmse_dy": 0.06295467168092728,
      "pose_rmse_mean": 0.08323600143194199,
      "rmse_dtheta": 0.020871704444289207,
      "rmse_dx": 0.004584828857332468,
      "rmse_dy": 0.006205006968230009,
      "rmse_mean": 0.010553847067058086,
      "rotation_flip": 0.0037205456756055355,
      "sparse_tokens": 32089.0,
      "step": 5447,
      "turn_loss": 0.07101590931415558,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24338.0,
      "epoch": 0.25311280431146627,
      "grad_norm": 0.5117921233177185,
      "learning_rate": 5.806975215837264e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.02830844558775425,
      "mae_dx": 0.005972638260573149,
      "mae_dy": 0.004945976659655571,
      "pose_mae_dtheta": 0.2158377468585968,
      "pose_mae_dx": 0.053567204624414444,
      "pose_mae_dy": 0.05529718101024628,
      "pose_rmse_dtheta": 0.414004921913147,
      "pose_rmse_dx": 0.14931724965572357,
      "pose_rmse_dy": 0.12761521339416504,
      "pose_rmse_mean": 0.23031246662139893,
      "rmse_dtheta": 0.04704055190086365,
      "rmse_dx": 0.016413649544119835,
      "rmse_dy": 0.010318281129002571,
      "rmse_mean": 0.024590827524662018,
      "rotation_flip": 0.014096916653215885,
      "sparse_tokens": 20149.0,
      "step": 5448,
      "turn_loss": 0.2227068841457367,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.25315926407730904,
      "grad_norm": 0.4985729455947876,
      "learning_rate": 5.805670302954322e-06,
      "loss": 0.1222,
      "mae_dtheta": 0.010535996407270432,
      "mae_dx": 0.0011831624433398247,
      "mae_dy": 0.00234073749743402,
      "pose_mae_dtheta": 0.07879622280597687,
      "pose_mae_dx": 0.022069988772273064,
      "pose_mae_dy": 0.03485554829239845,
      "pose_rmse_dtheta": 0.18629275262355804,
      "pose_rmse_dx": 0.06193818524479866,
      "pose_rmse_dy": 0.09160386770963669,
      "pose_rmse_mean": 0.11327826976776123,
      "rmse_dtheta": 0.021631324663758278,
      "rmse_dx": 0.0036834382917732,
      "rmse_dy": 0.0053320471197366714,
      "rmse_mean": 0.01021560374647379,
      "rotation_flip": 0.004100040998309851,
      "sparse_tokens": 32073.0,
      "step": 5449,
      "turn_loss": 0.0800488293170929,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2532057238431518,
      "grad_norm": 0.3244677782058716,
      "learning_rate": 5.804365333730422e-06,
      "loss": 0.0878,
      "mae_dtheta": 0.012796801514923573,
      "mae_dx": 0.002331628929823637,
      "mae_dy": 0.0025785863399505615,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.32446783781051636,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 167.56211853027344,
      "model/head/act_norm_mean": 111.36061789772727,
      "model/head/act_norm_min": 59.29426956176758,
      "model/head/act_over_embed": 76.52805919384896,
      "model/head/grad_frac": 0.11304627358913422,
      "model/head/grad_norm": 0.03667987883090973,
      "model/head/grad_zero_frac": 0.00020844755636062473,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7002840909090909,
      "model/head/update_ratio": 0.000627505243755877,
      "model/head/weight_delta": 8.603574752807617,
      "model/head/weight_delta_rel": 0.150932177901268,
      "model/head/weight_norm": 58.4535026550293,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4204972982406616,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4204320599955897,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4203738272190094,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2889248477759299,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0659431591629982,
      "model/modality_embedder.encoders.pose/grad_norm": 0.02139643393456936,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5211153513824884,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0006918637081980705,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8080787658691406,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0917486846446991,
      "model/modality_embedder.encoders.pose/weight_norm": 30.925792694091797,
      "model/modality_embedder/grad_frac": 0.0659431591629982,
      "model/modality_embedder/grad_norm": 0.02139643393456936,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5211153513824884,
      "model/modality_embedder/update_ratio": 0.0006918637081980705,
      "model/modality_embedder/weight_delta": 2.8080787658691406,
      "model/modality_embedder/weight_delta_rel": 0.0917486846446991,
      "model/modality_embedder/weight_norm": 30.925792694091797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.6076889038086,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.667440776815777,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.029296875,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.264486879899373,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10271362960338593,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03332727029919624,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011973482323810458,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.1519927978515625,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07841991633176804,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.8342342376709,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.14822387695312,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.635176166426167,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.370267868041992,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.929523699721095,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08770036697387695,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02845594845712185,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009626439423300326,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.725775718688965,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09442300349473953,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.56020164489746,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.27587127685547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.464849386724385,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.288771629333496,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.186892266380603,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08955158293247223,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0290566086769104,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009521081228740513,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.934488534927368,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09853462874889374,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.51818084716797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.20333862304688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.262004970338303,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.598334312438965,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.421914408675747,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09558922052383423,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.031015627086162567,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010412035044282675,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.5066845417022705,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08566658198833466,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.78824806213379,
      "model/normalizer/grad_frac": 0.4400178790092468,
      "model/normalizer/grad_norm": 0.1427716463804245,
      "model/normalizer/grad_zero_frac": 0.00020089553436264396,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018205480882897973,
      "model/normalizer/weight_delta": 5.313036918640137,
      "model/normalizer/weight_delta_rel": 0.06842883676290512,
      "model/normalizer/weight_norm": 78.4223403930664,
      "pose_mae_dtheta": 0.0914662629365921,
      "pose_mae_dx": 0.03268977999687195,
      "pose_mae_dy": 0.03758062794804573,
      "pose_rmse_dtheta": 0.2053704708814621,
      "pose_rmse_dx": 0.10244576632976532,
      "pose_rmse_dy": 0.0958980917930603,
      "pose_rmse_mean": 0.13457144796848297,
      "rmse_dtheta": 0.024841787293553352,
      "rmse_dx": 0.008664887398481369,
      "rmse_dy": 0.005431403871625662,
      "rmse_mean": 0.012979360297322273,
      "rotation_flip": 0.004115226212888956,
      "sparse_tokens": 32057.0,
      "step": 5450,
      "turn_loss": 0.10687390714883804,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2532521836089946,
      "grad_norm": 0.6918080449104309,
      "learning_rate": 5.803060308256824e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.010885382071137428,
      "mae_dx": 0.002279561012983322,
      "mae_dy": 0.002762766554951668,
      "pose_mae_dtheta": 0.07386784255504608,
      "pose_mae_dx": 0.025509588420391083,
      "pose_mae_dy": 0.029651282355189323,
      "pose_rmse_dtheta": 0.18068188428878784,
      "pose_rmse_dx": 0.07511268556118011,
      "pose_rmse_dy": 0.07495739310979843,
      "pose_rmse_mean": 0.11025066673755646,
      "rmse_dtheta": 0.023790322244167328,
      "rmse_dx": 0.008260433562099934,
      "rmse_dy": 0.006198402494192123,
      "rmse_mean": 0.012749719433486462,
      "rotation_flip": 0.007745266892015934,
      "sparse_tokens": 32041.0,
      "step": 5451,
      "turn_loss": 0.10437149554491043,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2532986433748374,
      "grad_norm": 0.32984182238578796,
      "learning_rate": 5.801755226624787e-06,
      "loss": 0.0633,
      "mae_dtheta": 0.009442349895834923,
      "mae_dx": 0.0018683242378756404,
      "mae_dy": 0.00259752431884408,
      "pose_mae_dtheta": 0.0720851793885231,
      "pose_mae_dx": 0.028881506994366646,
      "pose_mae_dy": 0.0359928235411644,
      "pose_rmse_dtheta": 0.19537338614463806,
      "pose_rmse_dx": 0.09591933339834213,
      "pose_rmse_dy": 0.10959777235984802,
      "pose_rmse_mean": 0.13363017141819,
      "rmse_dtheta": 0.021967219188809395,
      "rmse_dx": 0.006595700979232788,
      "rmse_dy": 0.0070761414244771,
      "rmse_mean": 0.011879688128829002,
      "rotation_flip": 0.0037807184271514416,
      "sparse_tokens": 32041.0,
      "step": 5452,
      "turn_loss": 0.07239217311143875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.25334510314068015,
      "grad_norm": 0.6489698886871338,
      "learning_rate": 5.800450088925576e-06,
      "loss": 0.1607,
      "mae_dtheta": 0.020513365045189857,
      "mae_dx": 0.007839644327759743,
      "mae_dy": 0.0038672462105751038,
      "pose_mae_dtheta": 0.15724517405033112,
      "pose_mae_dx": 0.08584169298410416,
      "pose_mae_dy": 0.06954291462898254,
      "pose_rmse_dtheta": 0.29968225955963135,
      "pose_rmse_dx": 0.23434823751449585,
      "pose_rmse_dy": 0.14374390244483948,
      "pose_rmse_mean": 0.22592481970787048,
      "rmse_dtheta": 0.03500298783183098,
      "rmse_dx": 0.021652355790138245,
      "rmse_dy": 0.007083181291818619,
      "rmse_mean": 0.021246176213026047,
      "rotation_flip": 0.011661808006465435,
      "sparse_tokens": 10829.0,
      "step": 5453,
      "turn_loss": 0.14306581020355225,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.2533915629065229,
      "grad_norm": 0.547210693359375,
      "learning_rate": 5.79914489525046e-06,
      "loss": 0.1383,
      "mae_dtheta": 0.03340397775173187,
      "mae_dx": 0.01414569467306137,
      "mae_dy": 0.010446213185787201,
      "pose_mae_dtheta": 0.23547588288784027,
      "pose_mae_dx": 0.11100798845291138,
      "pose_mae_dy": 0.1322740912437439,
      "pose_rmse_dtheta": 0.41381600499153137,
      "pose_rmse_dx": 0.23138189315795898,
      "pose_rmse_dy": 0.28463518619537354,
      "pose_rmse_mean": 0.30994436144828796,
      "rmse_dtheta": 0.04948794096708298,
      "rmse_dx": 0.027497850358486176,
      "rmse_dy": 0.019839374348521233,
      "rmse_mean": 0.03227505832910538,
      "rotation_flip": 0.011290322989225388,
      "sparse_tokens": 20756.0,
      "step": 5454,
      "turn_loss": 0.3351624310016632,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2534380226723657,
      "grad_norm": 0.49103039503097534,
      "learning_rate": 5.797839645690715e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.004313610959798098,
      "mae_dx": 0.0008101081475615501,
      "mae_dy": 0.000509682868141681,
      "pose_mae_dtheta": 0.026906652376055717,
      "pose_mae_dx": 0.006560685113072395,
      "pose_mae_dy": 0.0064910538494586945,
      "pose_rmse_dtheta": 0.12450552731752396,
      "pose_rmse_dx": 0.018143698573112488,
      "pose_rmse_dy": 0.022650886327028275,
      "pose_rmse_mean": 0.05510003864765167,
      "rmse_dtheta": 0.017783567309379578,
      "rmse_dx": 0.002436739858239889,
      "rmse_dy": 0.0014700391329824924,
      "rmse_mean": 0.0072301155887544155,
      "rotation_flip": 0.003645200515165925,
      "sparse_tokens": 32137.0,
      "step": 5455,
      "turn_loss": 0.03610774874687195,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.25348448243820854,
      "grad_norm": 0.665105402469635,
      "learning_rate": 5.796534340337614e-06,
      "loss": 0.1856,
      "mae_dtheta": 0.03830163925886154,
      "mae_dx": 0.011164835654199123,
      "mae_dy": 0.0035015547182410955,
      "pose_mae_dtheta": 0.32318130135536194,
      "pose_mae_dx": 0.08759788423776627,
      "pose_mae_dy": 0.05588201433420181,
      "pose_rmse_dtheta": 0.5805167555809021,
      "pose_rmse_dx": 0.21903762221336365,
      "pose_rmse_dy": 0.12673670053482056,
      "pose_rmse_mean": 0.30876368284225464,
      "rmse_dtheta": 0.056919779628515244,
      "rmse_dx": 0.024656420573592186,
      "rmse_dy": 0.006936179008334875,
      "rmse_mean": 0.02950412593781948,
      "rotation_flip": 0.012237762100994587,
      "sparse_tokens": 11665.0,
      "step": 5456,
      "turn_loss": 0.2503087520599365,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 15915.0,
      "epoch": 0.2535309422040513,
      "grad_norm": 0.7322394847869873,
      "learning_rate": 5.795228979282439e-06,
      "loss": 0.1656,
      "mae_dtheta": 0.02781836874783039,
      "mae_dx": 0.011565187014639378,
      "mae_dy": 0.003481089137494564,
      "pose_mae_dtheta": 0.20194841921329498,
      "pose_mae_dx": 0.09325918555259705,
      "pose_mae_dy": 0.05500392988324165,
      "pose_rmse_dtheta": 0.3460855782032013,
      "pose_rmse_dx": 0.24172182381153107,
      "pose_rmse_dy": 0.11988966912031174,
      "pose_rmse_mean": 0.23589903116226196,
      "rmse_dtheta": 0.04300842061638832,
      "rmse_dx": 0.025848299264907837,
      "rmse_dy": 0.006490952800959349,
      "rmse_mean": 0.02511589042842388,
      "rotation_flip": 0.010067113675177097,
      "sparse_tokens": 12986.0,
      "step": 5457,
      "turn_loss": 0.25669440627098083,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2535774019698941,
      "grad_norm": 0.39190107583999634,
      "learning_rate": 5.793923562616475e-06,
      "loss": 0.0753,
      "mae_dtheta": 0.005532772280275822,
      "mae_dx": 0.0011284409556537867,
      "mae_dy": 0.0006175910239107907,
      "pose_mae_dtheta": 0.03838912770152092,
      "pose_mae_dx": 0.009972285479307175,
      "pose_mae_dy": 0.009537603706121445,
      "pose_rmse_dtheta": 0.14370812475681305,
      "pose_rmse_dx": 0.026180030778050423,
      "pose_rmse_dy": 0.0250832661986351,
      "pose_rmse_mean": 0.06499047577381134,
      "rmse_dtheta": 0.019339224323630333,
      "rmse_dx": 0.0038556638173758984,
      "rmse_dy": 0.001298930263146758,
      "rmse_mean": 0.008164606988430023,
      "rotation_flip": 0.003376477165147662,
      "sparse_tokens": 32137.0,
      "step": 5458,
      "turn_loss": 0.03367967531085014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.25362386173573687,
      "grad_norm": 0.4962117373943329,
      "learning_rate": 5.792618090431008e-06,
      "loss": 0.1358,
      "mae_dtheta": 0.011030633002519608,
      "mae_dx": 0.001672261510975659,
      "mae_dy": 0.002060303697362542,
      "pose_mae_dtheta": 0.07230833917856216,
      "pose_mae_dx": 0.02334054931998253,
      "pose_mae_dy": 0.023566458374261856,
      "pose_rmse_dtheta": 0.21297410130500793,
      "pose_rmse_dx": 0.05228879302740097,
      "pose_rmse_dy": 0.052703890949487686,
      "pose_rmse_mean": 0.10598893463611603,
      "rmse_dtheta": 0.025801295414566994,
      "rmse_dx": 0.004447487648576498,
      "rmse_dy": 0.00428415322676301,
      "rmse_mean": 0.011510979384183884,
      "rotation_flip": 0.0040831477381289005,
      "sparse_tokens": 32137.0,
      "step": 5459,
      "turn_loss": 0.07716860622167587,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28785.0,
      "epoch": 0.25367032150157964,
      "grad_norm": 0.6464905738830566,
      "learning_rate": 5.791312562817335e-06,
      "loss": 0.1912,
      "mae_dtheta": 0.042183537036180496,
      "mae_dx": 0.015537970699369907,
      "mae_dy": 0.005843230988830328,
      "pose_mae_dtheta": 0.3524668514728546,
      "pose_mae_dx": 0.13306450843811035,
      "pose_mae_dy": 0.06550481915473938,
      "pose_rmse_dtheta": 0.5680845379829407,
      "pose_rmse_dx": 0.2668094336986542,
      "pose_rmse_dy": 0.1578035205602646,
      "pose_rmse_mean": 0.330899178981781,
      "rmse_dtheta": 0.06056544557213783,
      "rmse_dx": 0.02843618206679821,
      "rmse_dy": 0.012116419151425362,
      "rmse_mean": 0.03370601683855057,
      "rotation_flip": 0.015224913135170937,
      "sparse_tokens": 22595.0,
      "step": 5460,
      "turn_loss": 0.3474956154823303,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.2537167812674224,
      "grad_norm": 0.48059290647506714,
      "learning_rate": 5.79000697986675e-06,
      "loss": 0.0879,
      "mae_dtheta": 0.03399547189474106,
      "mae_dx": 0.006766489241272211,
      "mae_dy": 0.007275544106960297,
      "pose_mae_dtheta": 0.26736465096473694,
      "pose_mae_dx": 0.0789405032992363,
      "pose_mae_dy": 0.10570885241031647,
      "pose_rmse_dtheta": 0.4491916596889496,
      "pose_rmse_dx": 0.16130077838897705,
      "pose_rmse_dy": 0.2405668944120407,
      "pose_rmse_mean": 0.28368645906448364,
      "rmse_dtheta": 0.052109308540821075,
      "rmse_dx": 0.015655310824513435,
      "rmse_dy": 0.01687590777873993,
      "rmse_mean": 0.028213508427143097,
      "rotation_flip": 0.015384615398943424,
      "sparse_tokens": 3518.0,
      "step": 5461,
      "turn_loss": 0.2386629432439804,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2537632410332652,
      "grad_norm": 0.3823617398738861,
      "learning_rate": 5.788701341670553e-06,
      "loss": 0.085,
      "mae_dtheta": 0.008717072196304798,
      "mae_dx": 0.0013593198964372277,
      "mae_dy": 0.0017768393736332655,
      "pose_mae_dtheta": 0.05684949457645416,
      "pose_mae_dx": 0.019445229321718216,
      "pose_mae_dy": 0.021873733028769493,
      "pose_rmse_dtheta": 0.16266585886478424,
      "pose_rmse_dx": 0.0556657500565052,
      "pose_rmse_dy": 0.06011306121945381,
      "pose_rmse_mean": 0.09281489253044128,
      "rmse_dtheta": 0.021343817934393883,
      "rmse_dx": 0.003677531611174345,
      "rmse_dy": 0.004354288801550865,
      "rmse_mean": 0.009791879914700985,
      "rotation_flip": 0.004715127870440483,
      "sparse_tokens": 32153.0,
      "step": 5462,
      "turn_loss": 0.06473133713006973,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.253809700799108,
      "grad_norm": 0.6982706189155579,
      "learning_rate": 5.7873956483200465e-06,
      "loss": 0.124,
      "mae_dtheta": 0.021080588921904564,
      "mae_dx": 0.011065260507166386,
      "mae_dy": 0.004961439874023199,
      "pose_mae_dtheta": 0.12831629812717438,
      "pose_mae_dx": 0.08357319235801697,
      "pose_mae_dy": 0.03843621537089348,
      "pose_rmse_dtheta": 0.2160370647907257,
      "pose_rmse_dx": 0.19031833112239838,
      "pose_rmse_dy": 0.08484910428524017,
      "pose_rmse_mean": 0.16373483836650848,
      "rmse_dtheta": 0.034265756607055664,
      "rmse_dx": 0.022203760221600533,
      "rmse_dy": 0.009999562986195087,
      "rmse_mean": 0.022156361490488052,
      "rotation_flip": 0.019607843831181526,
      "sparse_tokens": 6285.0,
      "step": 5463,
      "turn_loss": 0.29698365926742554,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 16887.0,
      "epoch": 0.25385616056495075,
      "grad_norm": 0.5184723138809204,
      "learning_rate": 5.786089899906541e-06,
      "loss": 0.1005,
      "mae_dtheta": 0.03440744802355766,
      "mae_dx": 0.010195759125053883,
      "mae_dy": 0.0030603474006056786,
      "pose_mae_dtheta": 0.28305259346961975,
      "pose_mae_dx": 0.0785536840558052,
      "pose_mae_dy": 0.0463925302028656,
      "pose_rmse_dtheta": 0.5206582546234131,
      "pose_rmse_dx": 0.20570792257785797,
      "pose_rmse_dy": 0.11840465664863586,
      "pose_rmse_mean": 0.2815902829170227,
      "rmse_dtheta": 0.05444396287202835,
      "rmse_dx": 0.02272680588066578,
      "rmse_dy": 0.005999885033816099,
      "rmse_mean": 0.02772355079650879,
      "rotation_flip": 0.01097560953348875,
      "sparse_tokens": 13407.0,
      "step": 5464,
      "turn_loss": 0.2029823511838913,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.2539026203307935,
      "grad_norm": 0.6979900598526001,
      "learning_rate": 5.784784096521345e-06,
      "loss": 0.1819,
      "mae_dtheta": 0.05311997979879379,
      "mae_dx": 0.0060491254553198814,
      "mae_dy": 0.0037538486067205667,
      "pose_mae_dtheta": 0.4336654543876648,
      "pose_mae_dx": 0.04879618436098099,
      "pose_mae_dy": 0.049877144396305084,
      "pose_rmse_dtheta": 0.7290903329849243,
      "pose_rmse_dx": 0.10099627822637558,
      "pose_rmse_dy": 0.11320111155509949,
      "pose_rmse_mean": 0.31442925333976746,
      "rmse_dtheta": 0.07537507265806198,
      "rmse_dx": 0.013367362320423126,
      "rmse_dy": 0.009043834172189236,
      "rmse_mean": 0.032595425844192505,
      "rotation_flip": 0.012376237660646439,
      "sparse_tokens": 6854.0,
      "step": 5465,
      "turn_loss": 0.26728376746177673,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 8760.0,
      "epoch": 0.2539490800966363,
      "grad_norm": 0.5222053527832031,
      "learning_rate": 5.783478238255777e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.02966558001935482,
      "mae_dx": 0.010429532267153263,
      "mae_dy": 0.004855525214225054,
      "pose_mae_dtheta": 0.2507888972759247,
      "pose_mae_dx": 0.08164379000663757,
      "pose_mae_dy": 0.06327389180660248,
      "pose_rmse_dtheta": 0.514202892780304,
      "pose_rmse_dx": 0.19563594460487366,
      "pose_rmse_dy": 0.1363326758146286,
      "pose_rmse_mean": 0.2820571959018707,
      "rmse_dtheta": 0.049506302922964096,
      "rmse_dx": 0.02288956381380558,
      "rmse_dy": 0.008922796696424484,
      "rmse_mean": 0.02710622176527977,
      "rotation_flip": 0.022792022675275803,
      "sparse_tokens": 7517.0,
      "step": 5466,
      "turn_loss": 0.2347300797700882,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.2539955398624791,
      "grad_norm": 0.4878866672515869,
      "learning_rate": 5.782172325201155e-06,
      "loss": 0.1801,
      "mae_dtheta": 0.027306072413921356,
      "mae_dx": 0.005900286138057709,
      "mae_dy": 0.0031606571283191442,
      "pose_mae_dtheta": 0.2173653542995453,
      "pose_mae_dx": 0.05810697004199028,
      "pose_mae_dy": 0.03611261025071144,
      "pose_rmse_dtheta": 0.45529961585998535,
      "pose_rmse_dx": 0.1500644087791443,
      "pose_rmse_dy": 0.08103804290294647,
      "pose_rmse_mean": 0.2288006991147995,
      "rmse_dtheta": 0.047887448221445084,
      "rmse_dx": 0.014612717553973198,
      "rmse_dy": 0.0056585692800581455,
      "rmse_mean": 0.022719576954841614,
      "rotation_flip": 0.010152284055948257,
      "sparse_tokens": 7464.0,
      "step": 5467,
      "turn_loss": 0.1722068041563034,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.25404199962832186,
      "grad_norm": 0.49921944737434387,
      "learning_rate": 5.780866357448804e-06,
      "loss": 0.0708,
      "mae_dtheta": 0.009273642674088478,
      "mae_dx": 0.0010518627241253853,
      "mae_dy": 0.0017632617382332683,
      "pose_mae_dtheta": 0.06201400235295296,
      "pose_mae_dx": 0.013865613378584385,
      "pose_mae_dy": 0.02449934184551239,
      "pose_rmse_dtheta": 0.15711772441864014,
      "pose_rmse_dx": 0.03366607800126076,
      "pose_rmse_dy": 0.052851781249046326,
      "pose_rmse_mean": 0.0812118649482727,
      "rmse_dtheta": 0.019916336983442307,
      "rmse_dx": 0.0033873310312628746,
      "rmse_dy": 0.003828195156529546,
      "rmse_mean": 0.009043955244123936,
      "rotation_flip": 0.0020416495390236378,
      "sparse_tokens": 32073.0,
      "step": 5468,
      "turn_loss": 0.06438106298446655,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.25408845939416463,
      "grad_norm": 0.3186933100223541,
      "learning_rate": 5.7795603350900476e-06,
      "loss": 0.0595,
      "mae_dtheta": 0.008769339881837368,
      "mae_dx": 0.0012570535764098167,
      "mae_dy": 0.0017562740249559283,
      "pose_mae_dtheta": 0.05944163352251053,
      "pose_mae_dx": 0.0176914781332016,
      "pose_mae_dy": 0.021936003118753433,
      "pose_rmse_dtheta": 0.15257768332958221,
      "pose_rmse_dx": 0.045667614787817,
      "pose_rmse_dy": 0.049746811389923096,
      "pose_rmse_mean": 0.08266404271125793,
      "rmse_dtheta": 0.020792294293642044,
      "rmse_dx": 0.003941455390304327,
      "rmse_dy": 0.003512860741466284,
      "rmse_mean": 0.009415537118911743,
      "rotation_flip": 0.0016941974172368646,
      "sparse_tokens": 32073.0,
      "step": 5469,
      "turn_loss": 0.0578988678753376,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.2541349191600074,
      "grad_norm": 0.5978879332542419,
      "learning_rate": 5.77825425821622e-06,
      "loss": 0.1626,
      "mae_dtheta": 0.03357026353478432,
      "mae_dx": 0.01654096692800522,
      "mae_dy": 0.007401206996291876,
      "pose_mae_dtheta": 0.285433828830719,
      "pose_mae_dx": 0.13210338354110718,
      "pose_mae_dy": 0.10728302597999573,
      "pose_rmse_dtheta": 0.4964810013771057,
      "pose_rmse_dx": 0.26312386989593506,
      "pose_rmse_dy": 0.21039307117462158,
      "pose_rmse_mean": 0.32333266735076904,
      "rmse_dtheta": 0.05124646797776222,
      "rmse_dx": 0.029884710907936096,
      "rmse_dy": 0.012890401296317577,
      "rmse_mean": 0.031340524554252625,
      "rotation_flip": 0.010406811721622944,
      "sparse_tokens": 19948.0,
      "step": 5470,
      "turn_loss": 0.33619222044944763,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 33634.0,
      "epoch": 0.2541813789258502,
      "grad_norm": 0.5456176996231079,
      "learning_rate": 5.776948126918652e-06,
      "loss": 0.1786,
      "mae_dtheta": 0.027899257838726044,
      "mae_dx": 0.009763908572494984,
      "mae_dy": 0.005196662154048681,
      "pose_mae_dtheta": 0.21647165715694427,
      "pose_mae_dx": 0.08975555747747421,
      "pose_mae_dy": 0.0705387145280838,
      "pose_rmse_dtheta": 0.3663167655467987,
      "pose_rmse_dx": 0.2333219349384308,
      "pose_rmse_dy": 0.159137561917305,
      "pose_rmse_mean": 0.25292542576789856,
      "rmse_dtheta": 0.043424732983112335,
      "rmse_dx": 0.02298651449382305,
      "rmse_dy": 0.009889055043458939,
      "rmse_mean": 0.025433436036109924,
      "rotation_flip": 0.015471166931092739,
      "sparse_tokens": 26258.0,
      "step": 5471,
      "turn_loss": 0.28554242849349976,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.254227838691693,
      "grad_norm": 0.3204028904438019,
      "learning_rate": 5.7756419412886856e-06,
      "loss": 0.0908,
      "mae_dtheta": 0.003509518224745989,
      "mae_dx": 0.0012326586293056607,
      "mae_dy": 0.0003616590111050755,
      "pose_mae_dtheta": 0.025425663217902184,
      "pose_mae_dx": 0.010222721844911575,
      "pose_mae_dy": 0.004138370510190725,
      "pose_rmse_dtheta": 0.11995892971754074,
      "pose_rmse_dx": 0.027079736813902855,
      "pose_rmse_dy": 0.011198267340660095,
      "pose_rmse_mean": 0.052745647728443146,
      "rmse_dtheta": 0.01650199666619301,
      "rmse_dx": 0.003929027356207371,
      "rmse_dy": 0.0009567856905050576,
      "rmse_mean": 0.007129269652068615,
      "rotation_flip": 0.001683501643128693,
      "sparse_tokens": 32137.0,
      "step": 5472,
      "turn_loss": 0.028064347803592682,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2542742984575358,
      "grad_norm": 0.3959015905857086,
      "learning_rate": 5.774335701417662e-06,
      "loss": 0.0901,
      "mae_dtheta": 0.015200027264654636,
      "mae_dx": 0.0035660616122186184,
      "mae_dy": 0.006053550634533167,
      "pose_mae_dtheta": 0.10447920858860016,
      "pose_mae_dx": 0.047548580914735794,
      "pose_mae_dy": 0.050580501556396484,
      "pose_rmse_dtheta": 0.21400779485702515,
      "pose_rmse_dx": 0.12382438033819199,
      "pose_rmse_dy": 0.11016040295362473,
      "pose_rmse_mean": 0.14933086931705475,
      "rmse_dtheta": 0.027118131518363953,
      "rmse_dx": 0.008689303882420063,
      "rmse_dy": 0.01245920080691576,
      "rmse_mean": 0.016088878735899925,
      "rotation_flip": 0.007113821338862181,
      "sparse_tokens": 32057.0,
      "step": 5473,
      "turn_loss": 0.16036668419837952,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.2543207582233786,
      "grad_norm": 0.5004927515983582,
      "learning_rate": 5.773029407396928e-06,
      "loss": 0.142,
      "mae_dtheta": 0.028754357248544693,
      "mae_dx": 0.011127141304314137,
      "mae_dy": 0.0026482711546123028,
      "pose_mae_dtheta": 0.25362443923950195,
      "pose_mae_dx": 0.08151563256978989,
      "pose_mae_dy": 0.03187524527311325,
      "pose_rmse_dtheta": 0.4496528208255768,
      "pose_rmse_dx": 0.1920335739850998,
      "pose_rmse_dy": 0.08533769100904465,
      "pose_rmse_mean": 0.24234136939048767,
      "rmse_dtheta": 0.04793025925755501,
      "rmse_dx": 0.023349393159151077,
      "rmse_dy": 0.005301085766404867,
      "rmse_mean": 0.02552691474556923,
      "rotation_flip": 0.005361930467188358,
      "sparse_tokens": 6280.0,
      "step": 5474,
      "turn_loss": 0.2614597976207733,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.25436721798922135,
      "grad_norm": 0.4515303075313568,
      "learning_rate": 5.771723059317832e-06,
      "loss": 0.092,
      "mae_dtheta": 0.009132164530456066,
      "mae_dx": 0.001407703384757042,
      "mae_dy": 0.0019219651585444808,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.45153045654296875,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.35682678222656,
      "model/head/act_norm_mean": 118.77886284722223,
      "model/head/act_norm_min": 50.57764434814453,
      "model/head/act_over_embed": 81.62594657384534,
      "model/head/grad_frac": 0.0980772003531456,
      "model/head/grad_norm": 0.044284842908382416,
      "model/head/grad_zero_frac": 0.00018274853937327862,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7020645912247475,
      "model/head/update_ratio": 0.0007575555937364697,
      "model/head/weight_delta": 8.61898422241211,
      "model/head/weight_delta_rel": 0.1512025147676468,
      "model/head/weight_norm": 58.457550048828125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4205837845802307,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42049832581394936,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42040926218032837,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2889703862666971,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08235964924097061,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03718788921833038,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.540706306561086,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012024431489408016,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8069252967834473,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09171099960803986,
      "model/modality_embedder.encoders.pose/weight_norm": 30.926942825317383,
      "model/modality_embedder/grad_frac": 0.08235964924097061,
      "model/modality_embedder/grad_norm": 0.03718788921833038,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.540706306561086,
      "model/modality_embedder/update_ratio": 0.0012024431489408016,
      "model/modality_embedder/weight_delta": 2.8069252967834473,
      "model/modality_embedder/weight_delta_rel": 0.09171099960803986,
      "model/modality_embedder/weight_norm": 30.926942825317383,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.84739685058594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.409048320506653,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.064228057861328,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.774126526962956,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06794402003288269,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.030678795650601387,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011021869722753763,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.158012628555298,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07863928377628326,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.834474563598633,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.02533721923828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.42380150713484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.373644828796387,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.47147441708286,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06880693137645721,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.031068425625562668,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010509900748729706,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.7324111461639404,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09465286135673523,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.56110382080078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.62911224365234,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.258004148629148,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.323199272155762,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.731955644393427,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07538416981697083,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.034038249403238297,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001115296850912273,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.942410469055176,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09880063682794571,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.519451141357422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.1162109375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.01713814734648,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.332852363586426,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.940848997583952,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08153828233480453,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03681701794266701,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012359007960185409,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.513559103012085,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08590152114629745,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.789623260498047,
      "model/normalizer/grad_frac": 0.3029118478298187,
      "model/normalizer/grad_norm": 0.13677392899990082,
      "model/normalizer/grad_zero_frac": 0.00018316945352125913,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001744041102938354,
      "model/normalizer/weight_delta": 5.327022075653076,
      "model/normalizer/weight_delta_rel": 0.06860896199941635,
      "model/normalizer/weight_norm": 78.42356872558594,
      "pose_mae_dtheta": 0.06010480597615242,
      "pose_mae_dx": 0.016378385946154594,
      "pose_mae_dy": 0.026844996958971024,
      "pose_rmse_dtheta": 0.13204075396060944,
      "pose_rmse_dx": 0.03797094151377678,
      "pose_rmse_dy": 0.07455971837043762,
      "pose_rmse_mean": 0.08152380585670471,
      "rmse_dtheta": 0.019293474033474922,
      "rmse_dx": 0.004932353273034096,
      "rmse_dy": 0.005141719710081816,
      "rmse_mean": 0.009789182804524899,
      "rotation_flip": 0.002419354859739542,
      "sparse_tokens": 32089.0,
      "step": 5475,
      "turn_loss": 0.08006016910076141,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.2544136777550641,
      "grad_norm": 0.46584370732307434,
      "learning_rate": 5.7704166572717295e-06,
      "loss": 0.0955,
      "mae_dtheta": 0.028140977025032043,
      "mae_dx": 0.010952790267765522,
      "mae_dy": 0.0022040465846657753,
      "pose_mae_dtheta": 0.21683301031589508,
      "pose_mae_dx": 0.08144959062337875,
      "pose_mae_dy": 0.03365546092391014,
      "pose_rmse_dtheta": 0.4189491868019104,
      "pose_rmse_dx": 0.22504812479019165,
      "pose_rmse_dy": 0.0876997709274292,
      "pose_rmse_mean": 0.24389903247356415,
      "rmse_dtheta": 0.04590735584497452,
      "rmse_dx": 0.024860050529241562,
      "rmse_dy": 0.005469508934766054,
      "rmse_mean": 0.0254123043268919,
      "rotation_flip": 0.004991680383682251,
      "sparse_tokens": 11563.0,
      "step": 5476,
      "turn_loss": 0.2459719479084015,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.2544601375209069,
      "grad_norm": 0.3373704254627228,
      "learning_rate": 5.769110201349976e-06,
      "loss": 0.0888,
      "mae_dtheta": 0.04275565966963768,
      "mae_dx": 0.009722593240439892,
      "mae_dy": 0.004769386723637581,
      "pose_mae_dtheta": 0.3311588764190674,
      "pose_mae_dx": 0.09007900208234787,
      "pose_mae_dy": 0.057203784584999084,
      "pose_rmse_dtheta": 0.5875813364982605,
      "pose_rmse_dx": 0.21202531456947327,
      "pose_rmse_dy": 0.11228705197572708,
      "pose_rmse_mean": 0.3039645850658417,
      "rmse_dtheta": 0.06279680132865906,
      "rmse_dx": 0.021349802613258362,
      "rmse_dy": 0.008316407911479473,
      "rmse_mean": 0.030821003019809723,
      "rotation_flip": 0.013698630034923553,
      "sparse_tokens": 9608.0,
      "step": 5477,
      "turn_loss": 0.2259356528520584,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.2545065972867497,
      "grad_norm": 0.41219469904899597,
      "learning_rate": 5.7678036916439306e-06,
      "loss": 0.0938,
      "mae_dtheta": 0.010482107289135456,
      "mae_dx": 0.002074070041999221,
      "mae_dy": 0.002085953950881958,
      "pose_mae_dtheta": 0.07035226374864578,
      "pose_mae_dx": 0.022059708833694458,
      "pose_mae_dy": 0.02350776270031929,
      "pose_rmse_dtheta": 0.17063243687152863,
      "pose_rmse_dx": 0.04946020618081093,
      "pose_rmse_dy": 0.05725131556391716,
      "pose_rmse_mean": 0.09244798868894577,
      "rmse_dtheta": 0.02444714866578579,
      "rmse_dx": 0.005553201772272587,
      "rmse_dy": 0.004874718841165304,
      "rmse_mean": 0.011625023558735847,
      "rotation_flip": 0.003542330814525485,
      "sparse_tokens": 32233.0,
      "step": 5478,
      "turn_loss": 0.08403334766626358,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.25455305705259246,
      "grad_norm": 0.37765732407569885,
      "learning_rate": 5.766497128244963e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.010571240447461605,
      "mae_dx": 0.0023559825494885445,
      "mae_dy": 0.0028858648147433996,
      "pose_mae_dtheta": 0.07590998709201813,
      "pose_mae_dx": 0.02878234162926674,
      "pose_mae_dy": 0.03613485395908356,
      "pose_rmse_dtheta": 0.1760317087173462,
      "pose_rmse_dx": 0.07282036542892456,
      "pose_rmse_dy": 0.08335085958242416,
      "pose_rmse_mean": 0.11073431372642517,
      "rmse_dtheta": 0.022942515090107918,
      "rmse_dx": 0.008371512405574322,
      "rmse_dy": 0.006560899317264557,
      "rmse_mean": 0.01262497529387474,
      "rotation_flip": 0.0014646649360656738,
      "sparse_tokens": 32057.0,
      "step": 5479,
      "turn_loss": 0.10343403369188309,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.25459951681843523,
      "grad_norm": 0.7641246914863586,
      "learning_rate": 5.765190511244442e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.035338904708623886,
      "mae_dx": 0.011592364870011806,
      "mae_dy": 0.003405897179618478,
      "pose_mae_dtheta": 0.296891987323761,
      "pose_mae_dx": 0.08804307132959366,
      "pose_mae_dy": 0.04860071465373039,
      "pose_rmse_dtheta": 0.5222257375717163,
      "pose_rmse_dx": 0.21461014449596405,
      "pose_rmse_dy": 0.13100877404212952,
      "pose_rmse_mean": 0.28928157687187195,
      "rmse_dtheta": 0.054091475903987885,
      "rmse_dx": 0.02386332117021084,
      "rmse_dy": 0.007147579453885555,
      "rmse_mean": 0.028367459774017334,
      "rotation_flip": 0.006802720949053764,
      "sparse_tokens": 18832.0,
      "step": 5480,
      "turn_loss": 0.2829824686050415,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 22721.0,
      "epoch": 0.254645976584278,
      "grad_norm": 0.44138991832733154,
      "learning_rate": 5.763883840733736e-06,
      "loss": 0.1015,
      "mae_dtheta": 0.03780047968029976,
      "mae_dx": 0.010051028802990913,
      "mae_dy": 0.003832884831354022,
      "pose_mae_dtheta": 0.2994193732738495,
      "pose_mae_dx": 0.07995989918708801,
      "pose_mae_dy": 0.03820129111409187,
      "pose_rmse_dtheta": 0.557965874671936,
      "pose_rmse_dx": 0.19496667385101318,
      "pose_rmse_dy": 0.09966196119785309,
      "pose_rmse_mean": 0.28419816493988037,
      "rmse_dtheta": 0.058767907321453094,
      "rmse_dx": 0.02169145829975605,
      "rmse_dy": 0.008815446868538857,
      "rmse_mean": 0.029758270829916,
      "rotation_flip": 0.009066183120012283,
      "sparse_tokens": 17548.0,
      "step": 5481,
      "turn_loss": 0.2553997039794922,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2546924363501208,
      "grad_norm": 0.42041733860969543,
      "learning_rate": 5.762577116804223e-06,
      "loss": 0.1296,
      "mae_dtheta": 0.013802346773445606,
      "mae_dx": 0.0024176735896617174,
      "mae_dy": 0.0030741835944354534,
      "pose_mae_dtheta": 0.09189411252737045,
      "pose_mae_dx": 0.029859524220228195,
      "pose_mae_dy": 0.03356895595788956,
      "pose_rmse_dtheta": 0.23127299547195435,
      "pose_rmse_dx": 0.07314597070217133,
      "pose_rmse_dy": 0.08359763026237488,
      "pose_rmse_mean": 0.12933887541294098,
      "rmse_dtheta": 0.03022126853466034,
      "rmse_dx": 0.006631591357290745,
      "rmse_dy": 0.006764619145542383,
      "rmse_mean": 0.014539159834384918,
      "rotation_flip": 0.0052473763935267925,
      "sparse_tokens": 32121.0,
      "step": 5482,
      "turn_loss": 0.15977008640766144,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.25473889611596356,
      "grad_norm": 0.6911794543266296,
      "learning_rate": 5.761270339547283e-06,
      "loss": 0.1448,
      "mae_dtheta": 0.010584410279989243,
      "mae_dx": 0.0011334882583469152,
      "mae_dy": 0.001754852826707065,
      "pose_mae_dtheta": 0.0694180354475975,
      "pose_mae_dx": 0.014924815855920315,
      "pose_mae_dy": 0.02134832553565502,
      "pose_rmse_dtheta": 0.20715394616127014,
      "pose_rmse_dx": 0.038370128720998764,
      "pose_rmse_dy": 0.05141614004969597,
      "pose_rmse_mean": 0.09898006916046143,
      "rmse_dtheta": 0.025582939386367798,
      "rmse_dx": 0.0038596419617533684,
      "rmse_dy": 0.0035189182963222265,
      "rmse_mean": 0.010987166315317154,
      "rotation_flip": 0.006334459409117699,
      "sparse_tokens": 32073.0,
      "step": 5483,
      "turn_loss": 0.06404239684343338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.25478535588180634,
      "grad_norm": 0.4783998429775238,
      "learning_rate": 5.7599635090542995e-06,
      "loss": 0.1143,
      "mae_dtheta": 0.03373434767127037,
      "mae_dx": 0.011098030023276806,
      "mae_dy": 0.005868714768439531,
      "pose_mae_dtheta": 0.2508745491504669,
      "pose_mae_dx": 0.08816754817962646,
      "pose_mae_dy": 0.06443993747234344,
      "pose_rmse_dtheta": 0.4472203552722931,
      "pose_rmse_dx": 0.17979684472084045,
      "pose_rmse_dy": 0.15736618638038635,
      "pose_rmse_mean": 0.26146113872528076,
      "rmse_dtheta": 0.05118684843182564,
      "rmse_dx": 0.021132810041308403,
      "rmse_dy": 0.012821967713534832,
      "rmse_mean": 0.028380541130900383,
      "rotation_flip": 0.006203474011272192,
      "sparse_tokens": 14058.0,
      "step": 5484,
      "turn_loss": 0.33965736627578735,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.2548318156476491,
      "grad_norm": 0.6809111833572388,
      "learning_rate": 5.758656625416659e-06,
      "loss": 0.1527,
      "mae_dtheta": 0.04606269299983978,
      "mae_dx": 0.012044919654726982,
      "mae_dy": 0.007070859428495169,
      "pose_mae_dtheta": 0.37731292843818665,
      "pose_mae_dx": 0.10275978595018387,
      "pose_mae_dy": 0.09227665513753891,
      "pose_rmse_dtheta": 0.6606317162513733,
      "pose_rmse_dx": 0.2217150181531906,
      "pose_rmse_dy": 0.21681524813175201,
      "pose_rmse_mean": 0.36638733744621277,
      "rmse_dtheta": 0.06568553298711777,
      "rmse_dx": 0.024237757548689842,
      "rmse_dy": 0.012343277223408222,
      "rmse_mean": 0.0340888574719429,
      "rotation_flip": 0.013533834367990494,
      "sparse_tokens": 11031.0,
      "step": 5485,
      "turn_loss": 0.336317241191864,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.2548782754134919,
      "grad_norm": 0.4090736210346222,
      "learning_rate": 5.757349688725754e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.03328384459018707,
      "mae_dx": 0.010212589055299759,
      "mae_dy": 0.005838105920702219,
      "pose_mae_dtheta": 0.2690625786781311,
      "pose_mae_dx": 0.06655215471982956,
      "pose_mae_dy": 0.07439012080430984,
      "pose_rmse_dtheta": 0.47579270601272583,
      "pose_rmse_dx": 0.1738932579755783,
      "pose_rmse_dy": 0.20172780752182007,
      "pose_rmse_mean": 0.28380459547042847,
      "rmse_dtheta": 0.05174265429377556,
      "rmse_dx": 0.02219643071293831,
      "rmse_dy": 0.011742722243070602,
      "rmse_mean": 0.02856060490012169,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 6856.0,
      "step": 5486,
      "turn_loss": 0.2925399839878082,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 37198.0,
      "epoch": 0.25492473517933467,
      "grad_norm": 0.6492814421653748,
      "learning_rate": 5.756042699072979e-06,
      "loss": 0.1642,
      "mae_dtheta": 0.03268150985240936,
      "mae_dx": 0.012757119722664356,
      "mae_dy": 0.00369384721852839,
      "pose_mae_dtheta": 0.26606306433677673,
      "pose_mae_dx": 0.10587220638990402,
      "pose_mae_dy": 0.04049894958734512,
      "pose_rmse_dtheta": 0.46733370423316956,
      "pose_rmse_dx": 0.2225210815668106,
      "pose_rmse_dy": 0.11201214790344238,
      "pose_rmse_mean": 0.2672889828681946,
      "rmse_dtheta": 0.0508912168443203,
      "rmse_dx": 0.024828098714351654,
      "rmse_dy": 0.008635332807898521,
      "rmse_mean": 0.02811821550130844,
      "rotation_flip": 0.012711863964796066,
      "sparse_tokens": 29698.0,
      "step": 5487,
      "turn_loss": 0.26260343194007874,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2549711949451775,
      "grad_norm": 0.42888709902763367,
      "learning_rate": 5.754735656549733e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.008859721012413502,
      "mae_dx": 0.0014089826727285981,
      "mae_dy": 0.0006522280746139586,
      "pose_mae_dtheta": 0.06168679520487785,
      "pose_mae_dx": 0.012572393752634525,
      "pose_mae_dy": 0.009343435056507587,
      "pose_rmse_dtheta": 0.21931959688663483,
      "pose_rmse_dx": 0.03155957907438278,
      "pose_rmse_dy": 0.02707844227552414,
      "pose_rmse_mean": 0.09265254437923431,
      "rmse_dtheta": 0.02641097642481327,
      "rmse_dx": 0.004603295121341944,
      "rmse_dy": 0.0017668528016656637,
      "rmse_mean": 0.010927041992545128,
      "rotation_flip": 0.003597122384235263,
      "sparse_tokens": 32137.0,
      "step": 5488,
      "turn_loss": 0.060258835554122925,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2550176547110203,
      "grad_norm": 0.5882295966148376,
      "learning_rate": 5.753428561247416e-06,
      "loss": 0.1456,
      "mae_dtheta": 0.01235597301274538,
      "mae_dx": 0.0019215887878090143,
      "mae_dy": 0.0034018566366285086,
      "pose_mae_dtheta": 0.08451898396015167,
      "pose_mae_dx": 0.029333001002669334,
      "pose_mae_dy": 0.03866446018218994,
      "pose_rmse_dtheta": 0.1700177639722824,
      "pose_rmse_dx": 0.06600838154554367,
      "pose_rmse_dy": 0.08247725665569305,
      "pose_rmse_mean": 0.10616779327392578,
      "rmse_dtheta": 0.022306425496935844,
      "rmse_dx": 0.0055990503169596195,
      "rmse_dy": 0.006352568510919809,
      "rmse_mean": 0.011419348418712616,
      "rotation_flip": 0.006310196127742529,
      "sparse_tokens": 32089.0,
      "step": 5489,
      "turn_loss": 0.10040988028049469,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33310.0,
      "epoch": 0.25506411447686306,
      "grad_norm": 0.9684589505195618,
      "learning_rate": 5.752121413257436e-06,
      "loss": 0.3015,
      "mae_dtheta": 0.03478674218058586,
      "mae_dx": 0.013453969731926918,
      "mae_dy": 0.0032393429428339005,
      "pose_mae_dtheta": 0.27661463618278503,
      "pose_mae_dx": 0.11129337549209595,
      "pose_mae_dy": 0.04048353061079979,
      "pose_rmse_dtheta": 0.5115132331848145,
      "pose_rmse_dx": 0.25924086570739746,
      "pose_rmse_dy": 0.09663254022598267,
      "pose_rmse_mean": 0.2891288995742798,
      "rmse_dtheta": 0.054600734263658524,
      "rmse_dx": 0.026914894580841064,
      "rmse_dy": 0.0074532595463097095,
      "rmse_mean": 0.029656296595931053,
      "rotation_flip": 0.015394913032650948,
      "sparse_tokens": 24115.0,
      "step": 5490,
      "turn_loss": 0.26500409841537476,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.25511057424270583,
      "grad_norm": 0.47596555948257446,
      "learning_rate": 5.750814212671202e-06,
      "loss": 0.1328,
      "mae_dtheta": 0.00822494924068451,
      "mae_dx": 0.0017676636343821883,
      "mae_dy": 0.0024071913212537766,
      "pose_mae_dtheta": 0.05678292363882065,
      "pose_mae_dx": 0.020171208307147026,
      "pose_mae_dy": 0.02194317989051342,
      "pose_rmse_dtheta": 0.11337241530418396,
      "pose_rmse_dx": 0.05378995090723038,
      "pose_rmse_dy": 0.050462860614061356,
      "pose_rmse_mean": 0.072541743516922,
      "rmse_dtheta": 0.017360258847475052,
      "rmse_dx": 0.004810696002095938,
      "rmse_dy": 0.005578143987804651,
      "rmse_mean": 0.009249700233340263,
      "rotation_flip": 0.005370157305151224,
      "sparse_tokens": 32121.0,
      "step": 5491,
      "turn_loss": 0.0767296850681305,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2551570340085486,
      "grad_norm": 0.47665664553642273,
      "learning_rate": 5.749506959580127e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.014013429172337055,
      "mae_dx": 0.0015965788625180721,
      "mae_dy": 0.0025769956409931183,
      "pose_mae_dtheta": 0.10188798606395721,
      "pose_mae_dx": 0.022460954263806343,
      "pose_mae_dy": 0.02943398617208004,
      "pose_rmse_dtheta": 0.282678484916687,
      "pose_rmse_dx": 0.05793401226401329,
      "pose_rmse_dy": 0.07629246264696121,
      "pose_rmse_mean": 0.1389683187007904,
      "rmse_dtheta": 0.03168304264545441,
      "rmse_dx": 0.004464695230126381,
      "rmse_dy": 0.005877614952623844,
      "rmse_mean": 0.01400845032185316,
      "rotation_flip": 0.0030592733528465033,
      "sparse_tokens": 32121.0,
      "step": 5492,
      "turn_loss": 0.0993819460272789,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28785.0,
      "epoch": 0.2552034937743914,
      "grad_norm": 0.4826480448246002,
      "learning_rate": 5.748199654075628e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.03922086954116821,
      "mae_dx": 0.012917127460241318,
      "mae_dy": 0.004053705371916294,
      "pose_mae_dtheta": 0.3180326223373413,
      "pose_mae_dx": 0.10242582112550735,
      "pose_mae_dy": 0.05593996122479439,
      "pose_rmse_dtheta": 0.5786919593811035,
      "pose_rmse_dx": 0.2301904857158661,
      "pose_rmse_dy": 0.13315370678901672,
      "pose_rmse_mean": 0.3140120506286621,
      "rmse_dtheta": 0.059681471437215805,
      "rmse_dx": 0.025709282606840134,
      "rmse_dy": 0.009006205014884472,
      "rmse_mean": 0.03146565333008766,
      "rotation_flip": 0.012583271600306034,
      "sparse_tokens": 23539.0,
      "step": 5493,
      "turn_loss": 0.2451552301645279,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.25524995354023416,
      "grad_norm": 0.36130040884017944,
      "learning_rate": 5.746892296249126e-06,
      "loss": 0.0786,
      "mae_dtheta": 0.011196814477443695,
      "mae_dx": 0.001217999029904604,
      "mae_dy": 0.0021486759651452303,
      "pose_mae_dtheta": 0.07109730690717697,
      "pose_mae_dx": 0.020417261868715286,
      "pose_mae_dy": 0.030936183407902718,
      "pose_rmse_dtheta": 0.17208397388458252,
      "pose_rmse_dx": 0.05367084965109825,
      "pose_rmse_dy": 0.06483419239521027,
      "pose_rmse_mean": 0.09686301648616791,
      "rmse_dtheta": 0.021873287856578827,
      "rmse_dx": 0.0038435820024460554,
      "rmse_dy": 0.0043638464994728565,
      "rmse_mean": 0.010026905685663223,
      "rotation_flip": 0.0020964359864592552,
      "sparse_tokens": 32073.0,
      "step": 5494,
      "turn_loss": 0.08178191632032394,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33413.0,
      "epoch": 0.25529641330607694,
      "grad_norm": 0.8149851560592651,
      "learning_rate": 5.7455848861920445e-06,
      "loss": 0.2626,
      "mae_dtheta": 0.03258123993873596,
      "mae_dx": 0.010254605673253536,
      "mae_dy": 0.00392700033262372,
      "pose_mae_dtheta": 0.23683929443359375,
      "pose_mae_dx": 0.07509136945009232,
      "pose_mae_dy": 0.04750058427453041,
      "pose_rmse_dtheta": 0.4298301041126251,
      "pose_rmse_dx": 0.17371290922164917,
      "pose_rmse_dy": 0.11058460921049118,
      "pose_rmse_mean": 0.23804256319999695,
      "rmse_dtheta": 0.05050264298915863,
      "rmse_dx": 0.021972186863422394,
      "rmse_dy": 0.007407840341329575,
      "rmse_mean": 0.0266275554895401,
      "rotation_flip": 0.011936339549720287,
      "sparse_tokens": 25391.0,
      "step": 5495,
      "turn_loss": 0.26507824659347534,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.2553428730719197,
      "grad_norm": 0.46054667234420776,
      "learning_rate": 5.744277423995812e-06,
      "loss": 0.0899,
      "mae_dtheta": 0.023292677477002144,
      "mae_dx": 0.012623032554984093,
      "mae_dy": 0.002967818407341838,
      "pose_mae_dtheta": 0.17277304828166962,
      "pose_mae_dx": 0.0808810368180275,
      "pose_mae_dy": 0.03631041571497917,
      "pose_rmse_dtheta": 0.38171085715293884,
      "pose_rmse_dx": 0.17960424721240997,
      "pose_rmse_dy": 0.08219313621520996,
      "pose_rmse_mean": 0.21450275182724,
      "rmse_dtheta": 0.042665254324674606,
      "rmse_dx": 0.025927336886525154,
      "rmse_dy": 0.005492951720952988,
      "rmse_mean": 0.02469518408179283,
      "rotation_flip": 0.005494505632668734,
      "sparse_tokens": 7891.0,
      "step": 5496,
      "turn_loss": 0.17164786159992218,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2553893328377625,
      "grad_norm": 0.5060515999794006,
      "learning_rate": 5.7429699097518585e-06,
      "loss": 0.1558,
      "mae_dtheta": 0.007268266752362251,
      "mae_dx": 0.0012040811125189066,
      "mae_dy": 0.0014370441203936934,
      "pose_mae_dtheta": 0.04796065390110016,
      "pose_mae_dx": 0.014972030185163021,
      "pose_mae_dy": 0.018823502585291862,
      "pose_rmse_dtheta": 0.09993349760770798,
      "pose_rmse_dx": 0.03618515282869339,
      "pose_rmse_dy": 0.04678435996174812,
      "pose_rmse_mean": 0.060967668890953064,
      "rmse_dtheta": 0.01593533530831337,
      "rmse_dx": 0.0034372920636087656,
      "rmse_dy": 0.003199162892997265,
      "rmse_mean": 0.007523930631577969,
      "rotation_flip": 0.0007716049440205097,
      "sparse_tokens": 32137.0,
      "step": 5497,
      "turn_loss": 0.05676797777414322,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.25543579260360527,
      "grad_norm": 1.0949105024337769,
      "learning_rate": 5.7416623435516225e-06,
      "loss": 0.2621,
      "mae_dtheta": 0.035516638308763504,
      "mae_dx": 0.015362543985247612,
      "mae_dy": 0.0057598683051764965,
      "pose_mae_dtheta": 0.27574411034584045,
      "pose_mae_dx": 0.1156129464507103,
      "pose_mae_dy": 0.06208818405866623,
      "pose_rmse_dtheta": 0.48639237880706787,
      "pose_rmse_dx": 0.2317955493927002,
      "pose_rmse_dy": 0.15018555521965027,
      "pose_rmse_mean": 0.28945785760879517,
      "rmse_dtheta": 0.05638621002435684,
      "rmse_dx": 0.027693195268511772,
      "rmse_dy": 0.013990438543260098,
      "rmse_mean": 0.03268995136022568,
      "rotation_flip": 0.013833992183208466,
      "sparse_tokens": 10367.0,
      "step": 5498,
      "turn_loss": 0.3830075263977051,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.25548225236944805,
      "grad_norm": 0.44952142238616943,
      "learning_rate": 5.74035472548654e-06,
      "loss": 0.1141,
      "mae_dtheta": 0.01245083473622799,
      "mae_dx": 0.0021222683135420084,
      "mae_dy": 0.0027896594256162643,
      "pose_mae_dtheta": 0.0704650729894638,
      "pose_mae_dx": 0.024638019502162933,
      "pose_mae_dy": 0.030251916497945786,
      "pose_rmse_dtheta": 0.13724127411842346,
      "pose_rmse_dx": 0.050720635801553726,
      "pose_rmse_dy": 0.06692823767662048,
      "pose_rmse_mean": 0.08496338129043579,
      "rmse_dtheta": 0.023280063644051552,
      "rmse_dx": 0.005679040681570768,
      "rmse_dy": 0.0051849414594471455,
      "rmse_mean": 0.01138134952634573,
      "rotation_flip": 0.009421264752745628,
      "sparse_tokens": 32137.0,
      "step": 5499,
      "turn_loss": 0.13603124022483826,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2555287121352908,
      "grad_norm": 0.5353520512580872,
      "learning_rate": 5.7390470556480545e-06,
      "loss": 0.1445,
      "mae_dtheta": 0.011853613890707493,
      "mae_dx": 0.0027466779574751854,
      "mae_dy": 0.003917777445167303,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5353519916534424,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.96121215820312,
      "model/head/act_norm_mean": 107.0040739425505,
      "model/head/act_norm_min": 48.474212646484375,
      "model/head/act_over_embed": 73.53420140124439,
      "model/head/grad_frac": 0.11506002396345139,
      "model/head/grad_norm": 0.061597611755132675,
      "model/head/grad_zero_frac": 0.00018401762645225972,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7043580334595959,
      "model/head/update_ratio": 0.0010536639019846916,
      "model/head/weight_delta": 8.6334228515625,
      "model/head/weight_delta_rel": 0.1514558047056198,
      "model/head/weight_norm": 58.46039581298828,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42067283391952515,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42058973270365846,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42052149772644043,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28903320193706994,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09651612490415573,
      "model/modality_embedder.encoders.pose/grad_norm": 0.051670100539922714,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5295722053964758,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016707009635865688,
      "model/modality_embedder.encoders.pose/weight_delta": 2.811875820159912,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09187274426221848,
      "model/modality_embedder.encoders.pose/weight_norm": 30.92719841003418,
      "model/modality_embedder/grad_frac": 0.09651612490415573,
      "model/modality_embedder/grad_norm": 0.051670100539922714,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5295722053964758,
      "model/modality_embedder/update_ratio": 0.0016707009635865688,
      "model/modality_embedder/weight_delta": 2.811875820159912,
      "model/modality_embedder/weight_delta_rel": 0.09187274426221848,
      "model/modality_embedder/weight_norm": 30.92719841003418,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.42525482177734,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.404090508257173,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.134907722473145,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.08351010982184,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09153807908296585,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.049005091190338135,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017605242319405079,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.1634507179260254,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07883744686841965,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.83551025390625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.01351165771484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.415449134199132,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.513238906860352,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.77852522605779,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09971719980239868,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05338380113244057,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018057370325550437,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.739797830581665,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09490873664617538,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.56344223022461,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.15328216552734,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.319925444925445,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.212032318115234,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.08729917677705,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09977080672979355,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05341250076889992,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001749990857206285,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.9510319232940674,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09909012913703918,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.521589279174805,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.84716796875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.188081208914543,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.513834953308105,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.37111330774018,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10818250477313995,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05791572108864784,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019440692849457264,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.5199851989746094,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08612113445997238,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.79097557067871,
      "model/normalizer/grad_frac": 0.4429512619972229,
      "model/normalizer/grad_norm": 0.23713484406471252,
      "model/normalizer/grad_zero_frac": 0.00018789641035255045,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003023685421794653,
      "model/normalizer/weight_delta": 5.341540336608887,
      "model/normalizer/weight_delta_rel": 0.06879594922065735,
      "model/normalizer/weight_norm": 78.42576599121094,
      "pose_mae_dtheta": 0.07824628055095673,
      "pose_mae_dx": 0.028894467279314995,
      "pose_mae_dy": 0.030032940208911896,
      "pose_rmse_dtheta": 0.17769908905029297,
      "pose_rmse_dx": 0.07088923454284668,
      "pose_rmse_dy": 0.06037438288331032,
      "pose_rmse_mean": 0.10298757255077362,
      "rmse_dtheta": 0.026204913854599,
      "rmse_dx": 0.007769446354359388,
      "rmse_dy": 0.009089873172342777,
      "rmse_mean": 0.014354744926095009,
      "rotation_flip": 0.003235082607716322,
      "sparse_tokens": 32137.0,
      "step": 5500,
      "turn_loss": 0.13219624757766724,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2555751719011336,
      "grad_norm": 0.6844338774681091,
      "learning_rate": 5.737739334127611e-06,
      "loss": 0.1835,
      "mae_dtheta": 0.012489791959524155,
      "mae_dx": 0.0029856637120246887,
      "mae_dy": 0.004179785028100014,
      "pose_mae_dtheta": 0.08421705663204193,
      "pose_mae_dx": 0.03987567126750946,
      "pose_mae_dy": 0.038414474576711655,
      "pose_rmse_dtheta": 0.17959493398666382,
      "pose_rmse_dx": 0.11162948608398438,
      "pose_rmse_dy": 0.09506744146347046,
      "pose_rmse_mean": 0.12876395881175995,
      "rmse_dtheta": 0.024068443104624748,
      "rmse_dx": 0.007937674410641193,
      "rmse_dy": 0.009226933121681213,
      "rmse_mean": 0.013744350522756577,
      "rotation_flip": 0.006872852332890034,
      "sparse_tokens": 32121.0,
      "step": 5501,
      "turn_loss": 0.12290705740451813,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.2556216316669764,
      "grad_norm": 0.6520260572433472,
      "learning_rate": 5.73643156101666e-06,
      "loss": 0.1674,
      "mae_dtheta": 0.030888216570019722,
      "mae_dx": 0.01518727745860815,
      "mae_dy": 0.005353203974664211,
      "pose_mae_dtheta": 0.233189657330513,
      "pose_mae_dx": 0.12527918815612793,
      "pose_mae_dy": 0.07730318605899811,
      "pose_rmse_dtheta": 0.38435155153274536,
      "pose_rmse_dx": 0.27266570925712585,
      "pose_rmse_dy": 0.15954288840293884,
      "pose_rmse_mean": 0.2721867263317108,
      "rmse_dtheta": 0.04548311606049538,
      "rmse_dx": 0.028471872210502625,
      "rmse_dy": 0.009518160484731197,
      "rmse_mean": 0.027824383229017258,
      "rotation_flip": 0.010183298960328102,
      "sparse_tokens": 9795.0,
      "step": 5502,
      "turn_loss": 0.2720179557800293,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.25566809143281916,
      "grad_norm": 0.5832256078720093,
      "learning_rate": 5.735123736406655e-06,
      "loss": 0.1643,
      "mae_dtheta": 0.02361602708697319,
      "mae_dx": 0.012167144566774368,
      "mae_dy": 0.003685240400955081,
      "pose_mae_dtheta": 0.1691535860300064,
      "pose_mae_dx": 0.11108789592981339,
      "pose_mae_dy": 0.04872068390250206,
      "pose_rmse_dtheta": 0.3325413763523102,
      "pose_rmse_dx": 0.2583727240562439,
      "pose_rmse_dy": 0.11152003705501556,
      "pose_rmse_mean": 0.23414473235607147,
      "rmse_dtheta": 0.03804316744208336,
      "rmse_dx": 0.025797653943300247,
      "rmse_dy": 0.00745135685428977,
      "rmse_mean": 0.02376405894756317,
      "rotation_flip": 0.01727861724793911,
      "sparse_tokens": 20139.0,
      "step": 5503,
      "turn_loss": 0.20609058439731598,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.25571455119866193,
      "grad_norm": 0.37989240884780884,
      "learning_rate": 5.733815860389051e-06,
      "loss": 0.0822,
      "mae_dtheta": 0.009881317615509033,
      "mae_dx": 0.002117268508300185,
      "mae_dy": 0.0021931517403572798,
      "pose_mae_dtheta": 0.06733344495296478,
      "pose_mae_dx": 0.020286083221435547,
      "pose_mae_dy": 0.021860525012016296,
      "pose_rmse_dtheta": 0.16525384783744812,
      "pose_rmse_dx": 0.05130675807595253,
      "pose_rmse_dy": 0.04575219750404358,
      "pose_rmse_mean": 0.08743759989738464,
      "rmse_dtheta": 0.021873977035284042,
      "rmse_dx": 0.00667884387075901,
      "rmse_dy": 0.005785496439784765,
      "rmse_mean": 0.011446106247603893,
      "rotation_flip": 0.00578592112287879,
      "sparse_tokens": 32073.0,
      "step": 5504,
      "turn_loss": 0.08755364269018173,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.25576101096450476,
      "grad_norm": 0.4366401135921478,
      "learning_rate": 5.732507933055311e-06,
      "loss": 0.0923,
      "mae_dtheta": 0.010631928220391273,
      "mae_dx": 0.0019503848161548376,
      "mae_dy": 0.0028981962241232395,
      "pose_mae_dtheta": 0.06781263649463654,
      "pose_mae_dx": 0.02880183979868889,
      "pose_mae_dy": 0.030921638011932373,
      "pose_rmse_dtheta": 0.15429238975048065,
      "pose_rmse_dx": 0.07246875762939453,
      "pose_rmse_dy": 0.06163804605603218,
      "pose_rmse_mean": 0.09613306820392609,
      "rmse_dtheta": 0.021852942183613777,
      "rmse_dx": 0.005296398885548115,
      "rmse_dy": 0.005779579281806946,
      "rmse_mean": 0.010976307094097137,
      "rotation_flip": 0.004767143167555332,
      "sparse_tokens": 32057.0,
      "step": 5505,
      "turn_loss": 0.0828968957066536,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.25580747073034754,
      "grad_norm": 0.9479741454124451,
      "learning_rate": 5.731199954496899e-06,
      "loss": 0.2596,
      "mae_dtheta": 0.026997463777661324,
      "mae_dx": 0.013381662778556347,
      "mae_dy": 0.005067876074463129,
      "pose_mae_dtheta": 0.2467663437128067,
      "pose_mae_dx": 0.10862846672534943,
      "pose_mae_dy": 0.09320385754108429,
      "pose_rmse_dtheta": 0.436933308839798,
      "pose_rmse_dx": 0.24608521163463593,
      "pose_rmse_dy": 0.20747025310993195,
      "pose_rmse_mean": 0.29682958126068115,
      "rmse_dtheta": 0.04360773041844368,
      "rmse_dx": 0.026953859254717827,
      "rmse_dy": 0.00964427925646305,
      "rmse_mean": 0.02673528902232647,
      "rotation_flip": 0.011131725274026394,
      "sparse_tokens": 9779.0,
      "step": 5506,
      "turn_loss": 0.199213907122612,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2558539304961903,
      "grad_norm": 0.3380855619907379,
      "learning_rate": 5.729891924805281e-06,
      "loss": 0.0852,
      "mae_dtheta": 0.012952004559338093,
      "mae_dx": 0.0014890837483108044,
      "mae_dy": 0.0027482700534164906,
      "pose_mae_dtheta": 0.0865936353802681,
      "pose_mae_dx": 0.0216177087277174,
      "pose_mae_dy": 0.03299235925078392,
      "pose_rmse_dtheta": 0.23086678981781006,
      "pose_rmse_dx": 0.06098904460668564,
      "pose_rmse_dy": 0.08130622655153275,
      "pose_rmse_mean": 0.12438735365867615,
      "rmse_dtheta": 0.02688530832529068,
      "rmse_dx": 0.004554972983896732,
      "rmse_dy": 0.0065837763249874115,
      "rmse_mean": 0.012674685567617416,
      "rotation_flip": 0.004852557089179754,
      "sparse_tokens": 32057.0,
      "step": 5507,
      "turn_loss": 0.08957644551992416,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32115.0,
      "epoch": 0.2559003902620331,
      "grad_norm": 0.43532177805900574,
      "learning_rate": 5.728583844071929e-06,
      "loss": 0.1894,
      "mae_dtheta": 0.037792645394802094,
      "mae_dx": 0.01021497044712305,
      "mae_dy": 0.004321593325585127,
      "pose_mae_dtheta": 0.302232563495636,
      "pose_mae_dx": 0.07813933491706848,
      "pose_mae_dy": 0.040333040058612823,
      "pose_rmse_dtheta": 0.5284709334373474,
      "pose_rmse_dx": 0.19043944776058197,
      "pose_rmse_dy": 0.10539357364177704,
      "pose_rmse_mean": 0.27476799488067627,
      "rmse_dtheta": 0.05684126168489456,
      "rmse_dx": 0.021680312231183052,
      "rmse_dy": 0.010297725908458233,
      "rmse_mean": 0.02960643172264099,
      "rotation_flip": 0.013404825702309608,
      "sparse_tokens": 24912.0,
      "step": 5508,
      "turn_loss": 0.2646574079990387,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.25594685002787587,
      "grad_norm": 0.3862914443016052,
      "learning_rate": 5.727275712388318e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.0100177600979805,
      "mae_dx": 0.002207196084782481,
      "mae_dy": 0.0028304511215537786,
      "pose_mae_dtheta": 0.07411933690309525,
      "pose_mae_dx": 0.02467186562716961,
      "pose_mae_dy": 0.028066590428352356,
      "pose_rmse_dtheta": 0.1943017989397049,
      "pose_rmse_dx": 0.06180546060204506,
      "pose_rmse_dy": 0.06173930689692497,
      "pose_rmse_mean": 0.10594885796308517,
      "rmse_dtheta": 0.023495661094784737,
      "rmse_dx": 0.006915218196809292,
      "rmse_dy": 0.006794480606913567,
      "rmse_mean": 0.01240178756415844,
      "rotation_flip": 0.008874545805156231,
      "sparse_tokens": 32089.0,
      "step": 5509,
      "turn_loss": 0.08751215785741806,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.25599330979371865,
      "grad_norm": 0.5352703332901001,
      "learning_rate": 5.725967529845925e-06,
      "loss": 0.1303,
      "mae_dtheta": 0.008992747403681278,
      "mae_dx": 0.0018056400585919619,
      "mae_dy": 0.0019312594085931778,
      "pose_mae_dtheta": 0.06191372871398926,
      "pose_mae_dx": 0.01978309080004692,
      "pose_mae_dy": 0.025341065600514412,
      "pose_rmse_dtheta": 0.15753242373466492,
      "pose_rmse_dx": 0.04826359450817108,
      "pose_rmse_dy": 0.06340380012989044,
      "pose_rmse_mean": 0.08973327279090881,
      "rmse_dtheta": 0.020489180460572243,
      "rmse_dx": 0.004914098419249058,
      "rmse_dy": 0.004195272456854582,
      "rmse_mean": 0.009866184554994106,
      "rotation_flip": 0.004937333986163139,
      "sparse_tokens": 32153.0,
      "step": 5510,
      "turn_loss": 0.07603880763053894,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17159.0,
      "epoch": 0.2560397695595614,
      "grad_norm": 0.41942891478538513,
      "learning_rate": 5.724659296536234e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.02693231962621212,
      "mae_dx": 0.00963444821536541,
      "mae_dy": 0.004917093086987734,
      "pose_mae_dtheta": 0.19005846977233887,
      "pose_mae_dx": 0.07002900540828705,
      "pose_mae_dy": 0.043328434228897095,
      "pose_rmse_dtheta": 0.39519786834716797,
      "pose_rmse_dx": 0.18013396859169006,
      "pose_rmse_dy": 0.14498497545719147,
      "pose_rmse_mean": 0.24010559916496277,
      "rmse_dtheta": 0.04679030552506447,
      "rmse_dx": 0.021666042506694794,
      "rmse_dy": 0.013714137487113476,
      "rmse_mean": 0.027390163391828537,
      "rotation_flip": 0.012379642575979233,
      "sparse_tokens": 13534.0,
      "step": 5511,
      "turn_loss": 0.2251451313495636,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2560862293254042,
      "grad_norm": 0.35464760661125183,
      "learning_rate": 5.72335101255073e-06,
      "loss": 0.0891,
      "mae_dtheta": 0.0074175819754600525,
      "mae_dx": 0.0012850711354985833,
      "mae_dy": 0.001563878613524139,
      "pose_mae_dtheta": 0.050269123166799545,
      "pose_mae_dx": 0.015371655113995075,
      "pose_mae_dy": 0.018726294860243797,
      "pose_rmse_dtheta": 0.14022760093212128,
      "pose_rmse_dx": 0.04294630512595177,
      "pose_rmse_dy": 0.0489562526345253,
      "pose_rmse_mean": 0.07737672328948975,
      "rmse_dtheta": 0.019703593105077744,
      "rmse_dx": 0.004663058090955019,
      "rmse_dy": 0.003807129804044962,
      "rmse_mean": 0.009391260333359241,
      "rotation_flip": 0.005515719763934612,
      "sparse_tokens": 32073.0,
      "step": 5512,
      "turn_loss": 0.062266264110803604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.256132689091247,
      "grad_norm": 0.7415192127227783,
      "learning_rate": 5.7220426779809e-06,
      "loss": 0.1831,
      "mae_dtheta": 0.030145809054374695,
      "mae_dx": 0.013581912033259869,
      "mae_dy": 0.011956000700592995,
      "pose_mae_dtheta": 0.23088021576404572,
      "pose_mae_dx": 0.14730459451675415,
      "pose_mae_dy": 0.17742624878883362,
      "pose_rmse_dtheta": 0.39072829484939575,
      "pose_rmse_dx": 0.24632032215595245,
      "pose_rmse_dy": 0.4195134937763214,
      "pose_rmse_mean": 0.3521873652935028,
      "rmse_dtheta": 0.04360305145382881,
      "rmse_dx": 0.025591792538762093,
      "rmse_dy": 0.02211327850818634,
      "rmse_mean": 0.030436042696237564,
      "rotation_flip": 0.005494505632668734,
      "sparse_tokens": 2999.0,
      "step": 5513,
      "turn_loss": 0.35326728224754333,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.25617914885708976,
      "grad_norm": 0.4385761618614197,
      "learning_rate": 5.720734292918238e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.027219383046030998,
      "mae_dx": 0.007642383221536875,
      "mae_dy": 0.00278845289722085,
      "pose_mae_dtheta": 0.20851148664951324,
      "pose_mae_dx": 0.04774584621191025,
      "pose_mae_dy": 0.028944343328475952,
      "pose_rmse_dtheta": 0.4441390335559845,
      "pose_rmse_dx": 0.17163421213626862,
      "pose_rmse_dy": 0.07709868997335434,
      "pose_rmse_mean": 0.23095731437206268,
      "rmse_dtheta": 0.04775441065430641,
      "rmse_dx": 0.01993517391383648,
      "rmse_dy": 0.006021156441420317,
      "rmse_mean": 0.024570247158408165,
      "rotation_flip": 0.012867647223174572,
      "sparse_tokens": 9483.0,
      "step": 5514,
      "turn_loss": 0.21778540313243866,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.25622560862293253,
      "grad_norm": 0.4606044590473175,
      "learning_rate": 5.719425857454242e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.016427533701062202,
      "mae_dx": 0.004239701200276613,
      "mae_dy": 0.004433806519955397,
      "pose_mae_dtheta": 0.11840438842773438,
      "pose_mae_dx": 0.04376547038555145,
      "pose_mae_dy": 0.04249470680952072,
      "pose_rmse_dtheta": 0.291740745306015,
      "pose_rmse_dx": 0.13607950508594513,
      "pose_rmse_dy": 0.10451221466064453,
      "pose_rmse_mean": 0.17744415998458862,
      "rmse_dtheta": 0.03497451916337013,
      "rmse_dx": 0.012318181805312634,
      "rmse_dy": 0.01075717993080616,
      "rmse_mean": 0.0193499606102705,
      "rotation_flip": 0.004725554492324591,
      "sparse_tokens": 32121.0,
      "step": 5515,
      "turn_loss": 0.1593961864709854,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2562720683887753,
      "grad_norm": 0.41448652744293213,
      "learning_rate": 5.718117371680408e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.00837651826441288,
      "mae_dx": 0.0012606270611286163,
      "mae_dy": 0.0017013333272188902,
      "pose_mae_dtheta": 0.05358736962080002,
      "pose_mae_dx": 0.013649283908307552,
      "pose_mae_dy": 0.019325358793139458,
      "pose_rmse_dtheta": 0.1426357477903366,
      "pose_rmse_dx": 0.0342722050845623,
      "pose_rmse_dy": 0.040986813604831696,
      "pose_rmse_mean": 0.0726315900683403,
      "rmse_dtheta": 0.018884824588894844,
      "rmse_dx": 0.003966862335801125,
      "rmse_dy": 0.0035113513004034758,
      "rmse_mean": 0.008787679485976696,
      "rotation_flip": 0.006714225746691227,
      "sparse_tokens": 32089.0,
      "step": 5516,
      "turn_loss": 0.06273110955953598,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.2563185281546181,
      "grad_norm": 0.49498337507247925,
      "learning_rate": 5.716808835688241e-06,
      "loss": 0.1109,
      "mae_dtheta": 0.03475679084658623,
      "mae_dx": 0.014527622610330582,
      "mae_dy": 0.004570707678794861,
      "pose_mae_dtheta": 0.2941514253616333,
      "pose_mae_dx": 0.10959936678409576,
      "pose_mae_dy": 0.057992298156023026,
      "pose_rmse_dtheta": 0.5448472499847412,
      "pose_rmse_dx": 0.2589784562587738,
      "pose_rmse_dy": 0.17385193705558777,
      "pose_rmse_mean": 0.3258925676345825,
      "rmse_dtheta": 0.0550386980175972,
      "rmse_dx": 0.02809528447687626,
      "rmse_dy": 0.01235984731465578,
      "rmse_mean": 0.0318312793970108,
      "rotation_flip": 0.008310249075293541,
      "sparse_tokens": 20498.0,
      "step": 5517,
      "turn_loss": 0.2855447232723236,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.25636498792046086,
      "grad_norm": 0.5997743606567383,
      "learning_rate": 5.715500249569248e-06,
      "loss": 0.1578,
      "mae_dtheta": 0.010610022582113743,
      "mae_dx": 0.0025129939895123243,
      "mae_dy": 0.0027691207360476255,
      "pose_mae_dtheta": 0.08189231902360916,
      "pose_mae_dx": 0.02515416033565998,
      "pose_mae_dy": 0.02463904209434986,
      "pose_rmse_dtheta": 0.252073734998703,
      "pose_rmse_dx": 0.08600450307130814,
      "pose_rmse_dy": 0.06640175729990005,
      "pose_rmse_mean": 0.13482666015625,
      "rmse_dtheta": 0.027020728215575218,
      "rmse_dx": 0.009571593254804611,
      "rmse_dy": 0.00910272542387247,
      "rmse_mean": 0.015231681987643242,
      "rotation_flip": 0.004640371073037386,
      "sparse_tokens": 32105.0,
      "step": 5518,
      "turn_loss": 0.0912826806306839,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.25641144768630364,
      "grad_norm": 0.4149491786956787,
      "learning_rate": 5.714191613414939e-06,
      "loss": 0.0899,
      "mae_dtheta": 0.00900933425873518,
      "mae_dx": 0.0015280391089618206,
      "mae_dy": 0.0016862759366631508,
      "pose_mae_dtheta": 0.06708283722400665,
      "pose_mae_dx": 0.019554605707526207,
      "pose_mae_dy": 0.023840920999646187,
      "pose_rmse_dtheta": 0.2203119993209839,
      "pose_rmse_dx": 0.048173937946558,
      "pose_rmse_dy": 0.06988782435655594,
      "pose_rmse_mean": 0.11279125511646271,
      "rmse_dtheta": 0.024012411013245583,
      "rmse_dx": 0.00494395662099123,
      "rmse_dy": 0.0040143514052033424,
      "rmse_mean": 0.010990239679813385,
      "rotation_flip": 0.001973359612748027,
      "sparse_tokens": 32073.0,
      "step": 5519,
      "turn_loss": 0.07614069432020187,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.2564579074521464,
      "grad_norm": 0.5395899415016174,
      "learning_rate": 5.7128829273168255e-06,
      "loss": 0.0966,
      "mae_dtheta": 0.026881059631705284,
      "mae_dx": 0.012592966668307781,
      "mae_dy": 0.004022133070975542,
      "pose_mae_dtheta": 0.20338480174541473,
      "pose_mae_dx": 0.13109827041625977,
      "pose_mae_dy": 0.058907896280288696,
      "pose_rmse_dtheta": 0.38405612111091614,
      "pose_rmse_dx": 0.2955770194530487,
      "pose_rmse_dy": 0.12878143787384033,
      "pose_rmse_mean": 0.26947152614593506,
      "rmse_dtheta": 0.04263927787542343,
      "rmse_dx": 0.026367083191871643,
      "rmse_dy": 0.0079383235424757,
      "rmse_mean": 0.02564822882413864,
      "rotation_flip": 0.015810277312994003,
      "sparse_tokens": 4352.0,
      "step": 5520,
      "turn_loss": 0.20260126888751984,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 39466.0,
      "epoch": 0.25650436721798925,
      "grad_norm": 0.5684688091278076,
      "learning_rate": 5.711574191366427e-06,
      "loss": 0.1812,
      "mae_dtheta": 0.03651351109147072,
      "mae_dx": 0.016101030632853508,
      "mae_dy": 0.007718625012785196,
      "pose_mae_dtheta": 0.288011372089386,
      "pose_mae_dx": 0.15166118741035461,
      "pose_mae_dy": 0.08402854949235916,
      "pose_rmse_dtheta": 0.4956836998462677,
      "pose_rmse_dx": 0.29276782274246216,
      "pose_rmse_dy": 0.18804077804088593,
      "pose_rmse_mean": 0.32549744844436646,
      "rmse_dtheta": 0.05523485690355301,
      "rmse_dx": 0.02909839153289795,
      "rmse_dy": 0.01699855551123619,
      "rmse_mean": 0.03377726674079895,
      "rotation_flip": 0.015119916759431362,
      "sparse_tokens": 29866.0,
      "step": 5521,
      "turn_loss": 0.3413355350494385,
      "turns": 122.0,
      "turns_per_sample": 122.0
    },
    {
      "dense_tokens": 7817.0,
      "epoch": 0.256550826983832,
      "grad_norm": 0.5842171907424927,
      "learning_rate": 5.710265405655263e-06,
      "loss": 0.1587,
      "mae_dtheta": 0.037455108016729355,
      "mae_dx": 0.008264471776783466,
      "mae_dy": 0.005316571798175573,
      "pose_mae_dtheta": 0.2710855007171631,
      "pose_mae_dx": 0.07213741540908813,
      "pose_mae_dy": 0.07574733346700668,
      "pose_rmse_dtheta": 0.48631522059440613,
      "pose_rmse_dx": 0.15779635310173035,
      "pose_rmse_dy": 0.16887368261814117,
      "pose_rmse_mean": 0.2709950804710388,
      "rmse_dtheta": 0.05518275499343872,
      "rmse_dx": 0.018872054293751717,
      "rmse_dy": 0.00999066699296236,
      "rmse_mean": 0.02801515907049179,
      "rotation_flip": 0.007389162667095661,
      "sparse_tokens": 6323.0,
      "step": 5522,
      "turn_loss": 0.27219992876052856,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2565972867496748,
      "grad_norm": 0.39446309208869934,
      "learning_rate": 5.708956570274858e-06,
      "loss": 0.1108,
      "mae_dtheta": 0.01322291698306799,
      "mae_dx": 0.0022672873456031084,
      "mae_dy": 0.003403391456231475,
      "pose_mae_dtheta": 0.08127514272928238,
      "pose_mae_dx": 0.026836199685931206,
      "pose_mae_dy": 0.03488285094499588,
      "pose_rmse_dtheta": 0.1697515994310379,
      "pose_rmse_dx": 0.07278504967689514,
      "pose_rmse_dy": 0.08583145588636398,
      "pose_rmse_mean": 0.10945603251457214,
      "rmse_dtheta": 0.02475644089281559,
      "rmse_dx": 0.007147747091948986,
      "rmse_dy": 0.00782611221075058,
      "rmse_mean": 0.013243433088064194,
      "rotation_flip": 0.006070826202630997,
      "sparse_tokens": 32105.0,
      "step": 5523,
      "turn_loss": 0.11871686577796936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2566437465155176,
      "grad_norm": 0.48829421401023865,
      "learning_rate": 5.70764768531674e-06,
      "loss": 0.1423,
      "mae_dtheta": 0.011686746031045914,
      "mae_dx": 0.0013957079499959946,
      "mae_dy": 0.0023217054549604654,
      "pose_mae_dtheta": 0.07365148514509201,
      "pose_mae_dx": 0.01988609880208969,
      "pose_mae_dy": 0.0334247350692749,
      "pose_rmse_dtheta": 0.15010610222816467,
      "pose_rmse_dx": 0.04817879572510719,
      "pose_rmse_dy": 0.06760196387767792,
      "pose_rmse_mean": 0.08862894773483276,
      "rmse_dtheta": 0.021430684253573418,
      "rmse_dx": 0.004523890558630228,
      "rmse_dy": 0.004351857118308544,
      "rmse_mean": 0.010102144442498684,
      "rotation_flip": 0.007034431677311659,
      "sparse_tokens": 32057.0,
      "step": 5524,
      "turn_loss": 0.08170091360807419,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.25669020628136036,
      "grad_norm": 0.3987327218055725,
      "learning_rate": 5.706338750872439e-06,
      "loss": 0.0856,
      "mae_dtheta": 0.01155897043645382,
      "mae_dx": 0.002514579566195607,
      "mae_dy": 0.00253480882383883,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3987326920032501,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 173.313720703125,
      "model/head/act_norm_mean": 118.13521938131314,
      "model/head/act_norm_min": 58.42960739135742,
      "model/head/act_over_embed": 81.18362875818754,
      "model/head/grad_frac": 0.08336745947599411,
      "model/head/grad_norm": 0.033241331577301025,
      "model/head/grad_zero_frac": 0.0002062266576103866,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7134183633207071,
      "model/head/update_ratio": 0.0005685699288733304,
      "model/head/weight_delta": 8.650046348571777,
      "model/head/weight_delta_rel": 0.1517474353313446,
      "model/head/weight_norm": 58.46480941772461,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4206680655479431,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4205851308616674,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42051711678504944,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2890300395081705,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0997510477900505,
      "model/modality_embedder.encoders.pose/grad_norm": 0.039774004369974136,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5045297828638498,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001286020502448082,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8201541900634766,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0921432301402092,
      "model/modality_embedder.encoders.pose/weight_norm": 30.92797088623047,
      "model/modality_embedder/grad_frac": 0.0997510477900505,
      "model/modality_embedder/grad_norm": 0.039774004369974136,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5045297828638498,
      "model/modality_embedder/update_ratio": 0.001286020502448082,
      "model/modality_embedder/weight_delta": 2.8201541900634766,
      "model/modality_embedder/weight_delta_rel": 0.0921432301402092,
      "model/modality_embedder/weight_norm": 30.92797088623047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 96.08245086669922,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.312993526535195,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.032434463500977,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.70811677326662,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06604922562837601,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.026335984468460083,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009460718720220029,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.170015811920166,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07907668501138687,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.83719253540039,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 97.45709228515625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.261471360429695,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.13988971710205,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.359919620508308,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06550779938697815,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.026120100170373917,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.00088343775132671,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.748281955718994,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09520263224840164,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.566429138183594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 99.23832702636719,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.04664702581369,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.300809860229492,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.58670905083809,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07102473080158234,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.028319882228970528,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009277758072130382,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.960400104522705,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09940469264984131,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.52448844909668,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 99.84877014160156,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.81282567740901,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.2982177734375,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.800443555439443,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08883418887853622,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03542109578847885,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011888929875567555,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.5276038646698,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08638150244951248,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.79334259033203,
      "model/normalizer/grad_frac": 0.32422223687171936,
      "model/normalizer/grad_norm": 0.1292780041694641,
      "model/normalizer/grad_zero_frac": 0.0001772607647581026,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016483472427353263,
      "model/normalizer/weight_delta": 5.3579816818237305,
      "model/normalizer/weight_delta_rel": 0.06900770217180252,
      "model/normalizer/weight_norm": 78.42886352539062,
      "pose_mae_dtheta": 0.08074909448623657,
      "pose_mae_dx": 0.027754539623856544,
      "pose_mae_dy": 0.03599334508180618,
      "pose_rmse_dtheta": 0.18578343093395233,
      "pose_rmse_dx": 0.07699599862098694,
      "pose_rmse_dy": 0.10028378665447235,
      "pose_rmse_mean": 0.1210210770368576,
      "rmse_dtheta": 0.024299977347254753,
      "rmse_dx": 0.008369329385459423,
      "rmse_dy": 0.006401433143764734,
      "rmse_mean": 0.01302358042448759,
      "rotation_flip": 0.010972568765282631,
      "sparse_tokens": 32025.0,
      "step": 5525,
      "turn_loss": 0.09415917098522186,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.25673666604720313,
      "grad_norm": 0.6185013055801392,
      "learning_rate": 5.7050297670334905e-06,
      "loss": 0.1361,
      "mae_dtheta": 0.005098091904073954,
      "mae_dx": 0.0018654229352250695,
      "mae_dy": 0.0005189894582144916,
      "pose_mae_dtheta": 0.038685012608766556,
      "pose_mae_dx": 0.014348005875945091,
      "pose_mae_dy": 0.007274861913174391,
      "pose_rmse_dtheta": 0.19628626108169556,
      "pose_rmse_dx": 0.058940332382917404,
      "pose_rmse_dy": 0.016178341582417488,
      "pose_rmse_mean": 0.09046830981969833,
      "rmse_dtheta": 0.020482486113905907,
      "rmse_dx": 0.0071992720477283,
      "rmse_dy": 0.0011533752549439669,
      "rmse_mean": 0.009611711837351322,
      "rotation_flip": 0.0031999999191612005,
      "sparse_tokens": 32057.0,
      "step": 5526,
      "turn_loss": 0.03659576550126076,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.2567831258130459,
      "grad_norm": 0.4408125579357147,
      "learning_rate": 5.7037207338914326e-06,
      "loss": 0.0756,
      "mae_dtheta": 0.03231305629014969,
      "mae_dx": 0.024923712015151978,
      "mae_dy": 0.006685902830213308,
      "pose_mae_dtheta": 0.1444588005542755,
      "pose_mae_dx": 0.1891733855009079,
      "pose_mae_dy": 0.09661451727151871,
      "pose_rmse_dtheta": 0.22960969805717468,
      "pose_rmse_dx": 0.34787315130233765,
      "pose_rmse_dy": 0.1358427256345749,
      "pose_rmse_mean": 0.23777519166469574,
      "rmse_dtheta": 0.04547256976366043,
      "rmse_dx": 0.04007812216877937,
      "rmse_dy": 0.008256034925580025,
      "rmse_mean": 0.03126890957355499,
      "rotation_flip": 0.016129031777381897,
      "sparse_tokens": 3298.0,
      "step": 5527,
      "turn_loss": 0.251905232667923,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.2568295855788887,
      "grad_norm": 0.5381616353988647,
      "learning_rate": 5.702411651537805e-06,
      "loss": 0.1831,
      "mae_dtheta": 0.03217555955052376,
      "mae_dx": 0.00874706543982029,
      "mae_dy": 0.006175346672534943,
      "pose_mae_dtheta": 0.25303390622138977,
      "pose_mae_dx": 0.07290273159742355,
      "pose_mae_dy": 0.05584423616528511,
      "pose_rmse_dtheta": 0.4214516282081604,
      "pose_rmse_dx": 0.14568231999874115,
      "pose_rmse_dy": 0.1269918531179428,
      "pose_rmse_mean": 0.23137527704238892,
      "rmse_dtheta": 0.04825717583298683,
      "rmse_dx": 0.01789987087249756,
      "rmse_dy": 0.01179177314043045,
      "rmse_mean": 0.025982938706874847,
      "rotation_flip": 0.015138023532927036,
      "sparse_tokens": 18748.0,
      "step": 5528,
      "turn_loss": 0.27905067801475525,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.25687604534473146,
      "grad_norm": 0.38239526748657227,
      "learning_rate": 5.701102520064154e-06,
      "loss": 0.0769,
      "mae_dtheta": 0.012610020115971565,
      "mae_dx": 0.002333791460841894,
      "mae_dy": 0.0033658109605312347,
      "pose_mae_dtheta": 0.09224390983581543,
      "pose_mae_dx": 0.02966051548719406,
      "pose_mae_dy": 0.037579022347927094,
      "pose_rmse_dtheta": 0.23281557857990265,
      "pose_rmse_dx": 0.07727392762899399,
      "pose_rmse_dy": 0.08587200939655304,
      "pose_rmse_mean": 0.13198718428611755,
      "rmse_dtheta": 0.02799142524600029,
      "rmse_dx": 0.007020088378340006,
      "rmse_dy": 0.008895395323634148,
      "rmse_mean": 0.014635637402534485,
      "rotation_flip": 0.007633587811142206,
      "sparse_tokens": 32089.0,
      "step": 5529,
      "turn_loss": 0.1121322363615036,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.25692250511057424,
      "grad_norm": 0.3829924166202545,
      "learning_rate": 5.699793339562026e-06,
      "loss": 0.0962,
      "mae_dtheta": 0.009126352146267891,
      "mae_dx": 0.0010322321904823184,
      "mae_dy": 0.0022502411156892776,
      "pose_mae_dtheta": 0.06068442389369011,
      "pose_mae_dx": 0.015408935025334358,
      "pose_mae_dy": 0.027822712436318398,
      "pose_rmse_dtheta": 0.13641096651554108,
      "pose_rmse_dx": 0.04290204495191574,
      "pose_rmse_dy": 0.06694768369197845,
      "pose_rmse_mean": 0.08208689838647842,
      "rmse_dtheta": 0.019130980595946312,
      "rmse_dx": 0.003421970410272479,
      "rmse_dy": 0.005133018363267183,
      "rmse_mean": 0.009228656068444252,
      "rotation_flip": 0.0058139534667134285,
      "sparse_tokens": 32025.0,
      "step": 5530,
      "turn_loss": 0.06820711493492126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29754.0,
      "epoch": 0.256968964876417,
      "grad_norm": 0.3827736973762512,
      "learning_rate": 5.698484110122976e-06,
      "loss": 0.1183,
      "mae_dtheta": 0.03360879793763161,
      "mae_dx": 0.014640172012150288,
      "mae_dy": 0.0036659887991845608,
      "pose_mae_dtheta": 0.2679927349090576,
      "pose_mae_dx": 0.1220206469297409,
      "pose_mae_dy": 0.04395049065351486,
      "pose_rmse_dtheta": 0.5149807333946228,
      "pose_rmse_dx": 0.26562023162841797,
      "pose_rmse_dy": 0.10732389241456985,
      "pose_rmse_mean": 0.2959749698638916,
      "rmse_dtheta": 0.054191939532756805,
      "rmse_dx": 0.027972249314188957,
      "rmse_dy": 0.007641059346497059,
      "rmse_mean": 0.029935084283351898,
      "rotation_flip": 0.011848341673612595,
      "sparse_tokens": 24294.0,
      "step": 5531,
      "turn_loss": 0.26378506422042847,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2570154246422598,
      "grad_norm": 0.34178510308265686,
      "learning_rate": 5.697174831838557e-06,
      "loss": 0.0799,
      "mae_dtheta": 0.007954098284244537,
      "mae_dx": 0.001771021750755608,
      "mae_dy": 0.0020416860934346914,
      "pose_mae_dtheta": 0.05580346658825874,
      "pose_mae_dx": 0.017574278637766838,
      "pose_mae_dy": 0.01717083714902401,
      "pose_rmse_dtheta": 0.169333353638649,
      "pose_rmse_dx": 0.0520586222410202,
      "pose_rmse_dy": 0.05143284797668457,
      "pose_rmse_mean": 0.09094160795211792,
      "rmse_dtheta": 0.022616945207118988,
      "rmse_dx": 0.005241704173386097,
      "rmse_dy": 0.006173912435770035,
      "rmse_mean": 0.011344186961650848,
      "rotation_flip": 0.0024402146227657795,
      "sparse_tokens": 32169.0,
      "step": 5532,
      "turn_loss": 0.07212497293949127,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.25706188440810257,
      "grad_norm": 1.1816848516464233,
      "learning_rate": 5.695865504800328e-06,
      "loss": 0.2496,
      "mae_dtheta": 0.04181144759058952,
      "mae_dx": 0.021141424775123596,
      "mae_dy": 0.006827406119555235,
      "pose_mae_dtheta": 0.29922932386398315,
      "pose_mae_dx": 0.1505633443593979,
      "pose_mae_dy": 0.07094398885965347,
      "pose_rmse_dtheta": 0.5293546319007874,
      "pose_rmse_dx": 0.26600486040115356,
      "pose_rmse_dy": 0.20092308521270752,
      "pose_rmse_mean": 0.3320941925048828,
      "rmse_dtheta": 0.06113278493285179,
      "rmse_dx": 0.03333457186818123,
      "rmse_dy": 0.013091963715851307,
      "rmse_mean": 0.03585311025381088,
      "rotation_flip": 0.0,
      "sparse_tokens": 4725.0,
      "step": 5533,
      "turn_loss": 0.3057166337966919,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.25710834417394535,
      "grad_norm": 0.36943650245666504,
      "learning_rate": 5.694556129099851e-06,
      "loss": 0.074,
      "mae_dtheta": 0.006781428121030331,
      "mae_dx": 0.0007923076627776027,
      "mae_dy": 0.001449445728212595,
      "pose_mae_dtheta": 0.04388662055134773,
      "pose_mae_dx": 0.011551382020115852,
      "pose_mae_dy": 0.02016284316778183,
      "pose_rmse_dtheta": 0.08907715976238251,
      "pose_rmse_dx": 0.03301297873258591,
      "pose_rmse_dy": 0.046355485916137695,
      "pose_rmse_mean": 0.05614854022860527,
      "rmse_dtheta": 0.01381033193320036,
      "rmse_dx": 0.002835620893165469,
      "rmse_dy": 0.002893974306061864,
      "rmse_mean": 0.0065133096650242805,
      "rotation_flip": 0.0029387068934738636,
      "sparse_tokens": 32057.0,
      "step": 5534,
      "turn_loss": 0.0513908788561821,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12638.0,
      "epoch": 0.2571548039397881,
      "grad_norm": 0.5441044569015503,
      "learning_rate": 5.69324670482869e-06,
      "loss": 0.1148,
      "mae_dtheta": 0.029370658099651337,
      "mae_dx": 0.009222839027643204,
      "mae_dy": 0.0039099399000406265,
      "pose_mae_dtheta": 0.22686877846717834,
      "pose_mae_dx": 0.07159888744354248,
      "pose_mae_dy": 0.04122980311512947,
      "pose_rmse_dtheta": 0.4207938313484192,
      "pose_rmse_dx": 0.18477046489715576,
      "pose_rmse_dy": 0.09279981255531311,
      "pose_rmse_mean": 0.2327880561351776,
      "rmse_dtheta": 0.04651786386966705,
      "rmse_dx": 0.02053889073431492,
      "rmse_dy": 0.007526908069849014,
      "rmse_mean": 0.024861222133040428,
      "rotation_flip": 0.018148820847272873,
      "sparse_tokens": 10379.0,
      "step": 5535,
      "turn_loss": 0.2123820036649704,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2572012637056309,
      "grad_norm": 0.3117949068546295,
      "learning_rate": 5.691937232078415e-06,
      "loss": 0.074,
      "mae_dtheta": 0.010968325659632683,
      "mae_dx": 0.0020566785242408514,
      "mae_dy": 0.002713408088311553,
      "pose_mae_dtheta": 0.06841327250003815,
      "pose_mae_dx": 0.021908661350607872,
      "pose_mae_dy": 0.02984398789703846,
      "pose_rmse_dtheta": 0.1500760316848755,
      "pose_rmse_dx": 0.052721090614795685,
      "pose_rmse_dy": 0.0723072811961174,
      "pose_rmse_mean": 0.09170147031545639,
      "rmse_dtheta": 0.022148119285702705,
      "rmse_dx": 0.006077279802411795,
      "rmse_dy": 0.007008866406977177,
      "rmse_mean": 0.011744755320250988,
      "rotation_flip": 0.006211180239915848,
      "sparse_tokens": 32089.0,
      "step": 5536,
      "turn_loss": 0.10266996920108795,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.2572477234714737,
      "grad_norm": 1.032431721687317,
      "learning_rate": 5.6906277109406e-06,
      "loss": 0.2762,
      "mae_dtheta": 0.026691125705838203,
      "mae_dx": 0.00621950626373291,
      "mae_dy": 0.005142375826835632,
      "pose_mae_dtheta": 0.20726080238819122,
      "pose_mae_dx": 0.05907682329416275,
      "pose_mae_dy": 0.07504978775978088,
      "pose_rmse_dtheta": 0.4553268849849701,
      "pose_rmse_dx": 0.1612224131822586,
      "pose_rmse_dy": 0.14509530365467072,
      "pose_rmse_mean": 0.2538815438747406,
      "rmse_dtheta": 0.04587801173329353,
      "rmse_dx": 0.01758858561515808,
      "rmse_dy": 0.008827030658721924,
      "rmse_mean": 0.024097874760627747,
      "rotation_flip": 0.013921113684773445,
      "sparse_tokens": 10512.0,
      "step": 5537,
      "turn_loss": 0.22636264562606812,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2572941832373165,
      "grad_norm": 0.3179311156272888,
      "learning_rate": 5.689318141506816e-06,
      "loss": 0.0716,
      "mae_dtheta": 0.010982847772538662,
      "mae_dx": 0.0020599719136953354,
      "mae_dy": 0.002128848573192954,
      "pose_mae_dtheta": 0.08298569917678833,
      "pose_mae_dx": 0.0221093762665987,
      "pose_mae_dy": 0.027420297265052795,
      "pose_rmse_dtheta": 0.23049065470695496,
      "pose_rmse_dx": 0.053219735622406006,
      "pose_rmse_dy": 0.06389989703893661,
      "pose_rmse_mean": 0.11587010324001312,
      "rmse_dtheta": 0.025455886498093605,
      "rmse_dx": 0.006519511342048645,
      "rmse_dy": 0.004431541543453932,
      "rmse_mean": 0.012135646305978298,
      "rotation_flip": 0.0039200312457978725,
      "sparse_tokens": 32105.0,
      "step": 5538,
      "turn_loss": 0.08669564127922058,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2573406430031593,
      "grad_norm": 0.38088154792785645,
      "learning_rate": 5.688008523868646e-06,
      "loss": 0.0804,
      "mae_dtheta": 0.00816459208726883,
      "mae_dx": 0.001659081201069057,
      "mae_dy": 0.0013458274770528078,
      "pose_mae_dtheta": 0.05886887013912201,
      "pose_mae_dx": 0.017072957009077072,
      "pose_mae_dy": 0.01712004467844963,
      "pose_rmse_dtheta": 0.18780121207237244,
      "pose_rmse_dx": 0.04457434266805649,
      "pose_rmse_dy": 0.046497274190187454,
      "pose_rmse_mean": 0.09295761585235596,
      "rmse_dtheta": 0.02298111841082573,
      "rmse_dx": 0.005288552958518267,
      "rmse_dy": 0.0034106646198779345,
      "rmse_mean": 0.010560112074017525,
      "rotation_flip": 0.0042060986161231995,
      "sparse_tokens": 32105.0,
      "step": 5539,
      "turn_loss": 0.05732365697622299,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.25738710276900206,
      "grad_norm": 0.5450272560119629,
      "learning_rate": 5.68669885811767e-06,
      "loss": 0.0911,
      "mae_dtheta": 0.008717572316527367,
      "mae_dx": 0.0012793834321200848,
      "mae_dy": 0.0005600681761279702,
      "pose_mae_dtheta": 0.06279632449150085,
      "pose_mae_dx": 0.010561295785009861,
      "pose_mae_dy": 0.00770398648455739,
      "pose_rmse_dtheta": 0.24270325899124146,
      "pose_rmse_dx": 0.025356553494930267,
      "pose_rmse_dy": 0.019839031621813774,
      "pose_rmse_mean": 0.09596627950668335,
      "rmse_dtheta": 0.028689933940768242,
      "rmse_dx": 0.0035979137755930424,
      "rmse_dy": 0.0012811454944312572,
      "rmse_mean": 0.011189664714038372,
      "rotation_flip": 0.002255300059914589,
      "sparse_tokens": 32217.0,
      "step": 5540,
      "turn_loss": 0.0409662127494812,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.25743356253484484,
      "grad_norm": 0.3712211549282074,
      "learning_rate": 5.685389144345474e-06,
      "loss": 0.0821,
      "mae_dtheta": 0.006745882332324982,
      "mae_dx": 0.0013616548385471106,
      "mae_dy": 0.0008168006897903979,
      "pose_mae_dtheta": 0.04673626273870468,
      "pose_mae_dx": 0.012526925653219223,
      "pose_mae_dy": 0.011440660804510117,
      "pose_rmse_dtheta": 0.16430197656154633,
      "pose_rmse_dx": 0.028050102293491364,
      "pose_rmse_dy": 0.032965824007987976,
      "pose_rmse_mean": 0.07510597258806229,
      "rmse_dtheta": 0.02109317108988762,
      "rmse_dx": 0.003788120811805129,
      "rmse_dy": 0.001888472237624228,
      "rmse_mean": 0.008923254907131195,
      "rotation_flip": 0.0013824885245412588,
      "sparse_tokens": 32201.0,
      "step": 5541,
      "turn_loss": 0.04598132148385048,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20712.0,
      "epoch": 0.2574800223006876,
      "grad_norm": 1.019486665725708,
      "learning_rate": 5.684079382643645e-06,
      "loss": 0.2354,
      "mae_dtheta": 0.03387244790792465,
      "mae_dx": 0.015173402614891529,
      "mae_dy": 0.004424865823239088,
      "pose_mae_dtheta": 0.256223201751709,
      "pose_mae_dx": 0.11641712486743927,
      "pose_mae_dy": 0.0627768486738205,
      "pose_rmse_dtheta": 0.4543619453907013,
      "pose_rmse_dx": 0.27544867992401123,
      "pose_rmse_dy": 0.13741332292556763,
      "pose_rmse_mean": 0.2890746593475342,
      "rmse_dtheta": 0.05058460682630539,
      "rmse_dx": 0.029417507350444794,
      "rmse_dy": 0.008686535991728306,
      "rmse_mean": 0.02956288307905197,
      "rotation_flip": 0.011261261068284512,
      "sparse_tokens": 16636.0,
      "step": 5542,
      "turn_loss": 0.23575271666049957,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.2575264820665304,
      "grad_norm": 0.6779911518096924,
      "learning_rate": 5.6827695731037815e-06,
      "loss": 0.1482,
      "mae_dtheta": 0.048661008477211,
      "mae_dx": 0.01764247752726078,
      "mae_dy": 0.010491517372429371,
      "pose_mae_dtheta": 0.39607828855514526,
      "pose_mae_dx": 0.12220831960439682,
      "pose_mae_dy": 0.11390440911054611,
      "pose_rmse_dtheta": 0.6007630825042725,
      "pose_rmse_dx": 0.22816427052021027,
      "pose_rmse_dy": 0.23374737799167633,
      "pose_rmse_mean": 0.35422492027282715,
      "rmse_dtheta": 0.06638902425765991,
      "rmse_dx": 0.030497591942548752,
      "rmse_dy": 0.02171415090560913,
      "rmse_mean": 0.0395335927605629,
      "rotation_flip": 0.007633587811142206,
      "sparse_tokens": 5614.0,
      "step": 5543,
      "turn_loss": 0.508568286895752,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.25757294183237317,
      "grad_norm": 0.6598026752471924,
      "learning_rate": 5.6814597158174734e-06,
      "loss": 0.1408,
      "mae_dtheta": 0.030159341171383858,
      "mae_dx": 0.008901066146790981,
      "mae_dy": 0.002916494617238641,
      "pose_mae_dtheta": 0.24067069590091705,
      "pose_mae_dx": 0.07338112592697144,
      "pose_mae_dy": 0.036607999354600906,
      "pose_rmse_dtheta": 0.5098558068275452,
      "pose_rmse_dx": 0.16710031032562256,
      "pose_rmse_dy": 0.090191550552845,
      "pose_rmse_mean": 0.25571590662002563,
      "rmse_dtheta": 0.05291116610169411,
      "rmse_dx": 0.01991669461131096,
      "rmse_dy": 0.005434945225715637,
      "rmse_mean": 0.026087602600455284,
      "rotation_flip": 0.010526316240429878,
      "sparse_tokens": 13727.0,
      "step": 5544,
      "turn_loss": 0.21163028478622437,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.25761940159821595,
      "grad_norm": 0.4390316903591156,
      "learning_rate": 5.680149810876322e-06,
      "loss": 0.1287,
      "mae_dtheta": 0.013372745364904404,
      "mae_dx": 0.0028738933615386486,
      "mae_dy": 0.0040835426189005375,
      "pose_mae_dtheta": 0.08665426075458527,
      "pose_mae_dx": 0.03622403368353844,
      "pose_mae_dy": 0.037953123450279236,
      "pose_rmse_dtheta": 0.20211459696292877,
      "pose_rmse_dx": 0.08732394129037857,
      "pose_rmse_dy": 0.09000801295042038,
      "pose_rmse_mean": 0.12648218870162964,
      "rmse_dtheta": 0.027661088854074478,
      "rmse_dx": 0.00829311367124319,
      "rmse_dy": 0.009479924105107784,
      "rmse_mean": 0.0151447094976902,
      "rotation_flip": 0.004781169351190329,
      "sparse_tokens": 32105.0,
      "step": 5545,
      "turn_loss": 0.121520034968853,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.2576658613640587,
      "grad_norm": 0.4446991980075836,
      "learning_rate": 5.67883985837193e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.03864377737045288,
      "mae_dx": 0.01590433530509472,
      "mae_dy": 0.007559732533991337,
      "pose_mae_dtheta": 0.31268951296806335,
      "pose_mae_dx": 0.1322350949048996,
      "pose_mae_dy": 0.09559708833694458,
      "pose_rmse_dtheta": 0.5193469524383545,
      "pose_rmse_dx": 0.270406037569046,
      "pose_rmse_dy": 0.19047081470489502,
      "pose_rmse_mean": 0.3267412781715393,
      "rmse_dtheta": 0.0549207478761673,
      "rmse_dx": 0.028868230059742928,
      "rmse_dy": 0.013111544772982597,
      "rmse_mean": 0.03230017423629761,
      "rotation_flip": 0.022727273404598236,
      "sparse_tokens": 16338.0,
      "step": 5546,
      "turn_loss": 0.3108379542827606,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.2577123211299015,
      "grad_norm": 0.7274179458618164,
      "learning_rate": 5.677529858395901e-06,
      "loss": 0.1465,
      "mae_dtheta": 0.04045877978205681,
      "mae_dx": 0.006228918209671974,
      "mae_dy": 0.005361107178032398,
      "pose_mae_dtheta": 0.3351806700229645,
      "pose_mae_dx": 0.06072947010397911,
      "pose_mae_dy": 0.05716882646083832,
      "pose_rmse_dtheta": 0.6378113031387329,
      "pose_rmse_dx": 0.14014607667922974,
      "pose_rmse_dy": 0.1253761500120163,
      "pose_rmse_mean": 0.3011111915111542,
      "rmse_dtheta": 0.06265566498041153,
      "rmse_dx": 0.01479785330593586,
      "rmse_dy": 0.009626400656998158,
      "rmse_mean": 0.029026640579104424,
      "rotation_flip": 0.005802707746624947,
      "sparse_tokens": 9302.0,
      "step": 5547,
      "turn_loss": 0.2598039507865906,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2577587808957443,
      "grad_norm": 0.4812432527542114,
      "learning_rate": 5.676219811039844e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.0076956492848694324,
      "mae_dx": 0.0015901561127975583,
      "mae_dy": 0.0018000553827732801,
      "pose_mae_dtheta": 0.058199863880872726,
      "pose_mae_dx": 0.017390402033925056,
      "pose_mae_dy": 0.021565062925219536,
      "pose_rmse_dtheta": 0.1753673255443573,
      "pose_rmse_dx": 0.05449695512652397,
      "pose_rmse_dy": 0.06059006601572037,
      "pose_rmse_mean": 0.09681811928749084,
      "rmse_dtheta": 0.020759601145982742,
      "rmse_dx": 0.005843234248459339,
      "rmse_dy": 0.0050249225459992886,
      "rmse_mean": 0.010542585514485836,
      "rotation_flip": 0.00390625,
      "sparse_tokens": 32089.0,
      "step": 5548,
      "turn_loss": 0.0612076073884964,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.25780524066158705,
      "grad_norm": 0.4153185486793518,
      "learning_rate": 5.674909716395376e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.03869656100869179,
      "mae_dx": 0.013640027493238449,
      "mae_dy": 0.00227462244220078,
      "pose_mae_dtheta": 0.2829790711402893,
      "pose_mae_dx": 0.11244744062423706,
      "pose_mae_dy": 0.025495894253253937,
      "pose_rmse_dtheta": 0.49980899691581726,
      "pose_rmse_dx": 0.22536173462867737,
      "pose_rmse_dy": 0.0721600130200386,
      "pose_rmse_mean": 0.26577693223953247,
      "rmse_dtheta": 0.058764826506376266,
      "rmse_dx": 0.025335650891065598,
      "rmse_dy": 0.005475373473018408,
      "rmse_mean": 0.02985861711204052,
      "rotation_flip": 0.01795841194689274,
      "sparse_tokens": 16711.0,
      "step": 5549,
      "turn_loss": 0.2658587098121643,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.25785170042742983,
      "grad_norm": 0.4824090003967285,
      "learning_rate": 5.6735995745541075e-06,
      "loss": 0.0947,
      "mae_dtheta": 0.010827841237187386,
      "mae_dx": 0.0013430366525426507,
      "mae_dy": 0.001567835221067071,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.48240897059440613,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.72958374023438,
      "model/head/act_norm_mean": 119.00013809974747,
      "model/head/act_norm_min": 78.51980590820312,
      "model/head/act_over_embed": 81.77800899899223,
      "model/head/grad_frac": 0.08855325728654861,
      "model/head/grad_norm": 0.04271888732910156,
      "model/head/grad_zero_frac": 0.00019385304767638445,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7001065340909091,
      "model/head/update_ratio": 0.0007306342013180256,
      "model/head/weight_delta": 8.664395332336426,
      "model/head/weight_delta_rel": 0.15199916064739227,
      "model/head/weight_norm": 58.46822738647461,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42061376571655273,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42055628849909854,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4204886555671692,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2890102187665868,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1434846967458725,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06921830773353577,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5464154411764706,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0022380328737199306,
      "model/modality_embedder.encoders.pose/weight_delta": 2.821791410446167,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09219671785831451,
      "model/modality_embedder.encoders.pose/weight_norm": 30.928192138671875,
      "model/modality_embedder/grad_frac": 0.1434846967458725,
      "model/modality_embedder/grad_norm": 0.06921830773353577,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5464154411764706,
      "model/modality_embedder/update_ratio": 0.0022380328737199306,
      "model/modality_embedder/weight_delta": 2.821791410446167,
      "model/modality_embedder/weight_delta_rel": 0.09219671785831451,
      "model/modality_embedder/weight_norm": 30.928192138671875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.29031372070312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.464458573833575,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.041570663452148,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.812204971808182,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06863772124052048,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03311145305633545,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011894148774445057,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.175690174102783,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0792834609746933,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.838438034057617,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.09608459472656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.500025052108384,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.403162956237793,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.52385595080475,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05866619572043419,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.028301099315285683,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009571344126015902,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.7560436725616455,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09547150880098343,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.568572998046875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.95780944824219,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.37210898669232,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.48279094696045,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.810369557376767,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0645628347992897,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.031145690008997917,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00030765816336497664,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010202792473137379,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.968848466873169,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09968837350606918,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.52663230895996,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.5887451171875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.115783329324994,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.477486610412598,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.00863889017033,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07009993493556976,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03381683677434921,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011349772103130817,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.5343058109283447,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08661054819822311,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.795167922973633,
      "model/normalizer/grad_frac": 0.3139570653438568,
      "model/normalizer/grad_norm": 0.15145570039749146,
      "model/normalizer/grad_zero_frac": 0.0002481650735717267,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001931065577082336,
      "model/normalizer/weight_delta": 5.372724533081055,
      "model/normalizer/weight_delta_rel": 0.06919758021831512,
      "model/normalizer/weight_norm": 78.43115234375,
      "pose_mae_dtheta": 0.07537452131509781,
      "pose_mae_dx": 0.01717953197658062,
      "pose_mae_dy": 0.02237737365067005,
      "pose_rmse_dtheta": 0.2368500530719757,
      "pose_rmse_dx": 0.04611549898982048,
      "pose_rmse_dy": 0.05059158056974411,
      "pose_rmse_mean": 0.1111857146024704,
      "rmse_dtheta": 0.026952063664793968,
      "rmse_dx": 0.004436235409229994,
      "rmse_dy": 0.0033398924861103296,
      "rmse_mean": 0.011576063930988312,
      "rotation_flip": 0.00623441394418478,
      "sparse_tokens": 32089.0,
      "step": 5550,
      "turn_loss": 0.06906329095363617,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2578981601932726,
      "grad_norm": 0.38522207736968994,
      "learning_rate": 5.6722893856076596e-06,
      "loss": 0.0758,
      "mae_dtheta": 0.005999323446303606,
      "mae_dx": 0.001506633823737502,
      "mae_dy": 0.0012334717903286219,
      "pose_mae_dtheta": 0.045332394540309906,
      "pose_mae_dx": 0.019607480615377426,
      "pose_mae_dy": 0.019691042602062225,
      "pose_rmse_dtheta": 0.11520664393901825,
      "pose_rmse_dx": 0.06383110582828522,
      "pose_rmse_dy": 0.07043327391147614,
      "pose_rmse_mean": 0.0831570103764534,
      "rmse_dtheta": 0.01509484276175499,
      "rmse_dx": 0.00528392568230629,
      "rmse_dy": 0.0034133419394493103,
      "rmse_mean": 0.007930703461170197,
      "rotation_flip": 0.0025348542258143425,
      "sparse_tokens": 32089.0,
      "step": 5551,
      "turn_loss": 0.05193132162094116,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31790.0,
      "epoch": 0.2579446199591154,
      "grad_norm": 0.8876981139183044,
      "learning_rate": 5.670979149647654e-06,
      "loss": 0.3216,
      "mae_dtheta": 0.031235704198479652,
      "mae_dx": 0.01540416106581688,
      "mae_dy": 0.004966711159795523,
      "pose_mae_dtheta": 0.23860016465187073,
      "pose_mae_dx": 0.1120341569185257,
      "pose_mae_dy": 0.06265290081501007,
      "pose_rmse_dtheta": 0.41491904854774475,
      "pose_rmse_dx": 0.22473475337028503,
      "pose_rmse_dy": 0.15565766394138336,
      "pose_rmse_mean": 0.265103816986084,
      "rmse_dtheta": 0.0477278009057045,
      "rmse_dx": 0.02786349691450596,
      "rmse_dy": 0.010238931514322758,
      "rmse_mean": 0.028610076755285263,
      "rotation_flip": 0.007730147801339626,
      "sparse_tokens": 25169.0,
      "step": 5552,
      "turn_loss": 0.2859307825565338,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.25799107972495816,
      "grad_norm": 0.4614364802837372,
      "learning_rate": 5.669668866765717e-06,
      "loss": 0.1619,
      "mae_dtheta": 0.041553396731615067,
      "mae_dx": 0.009491867385804653,
      "mae_dy": 0.0046269455924630165,
      "pose_mae_dtheta": 0.30866050720214844,
      "pose_mae_dx": 0.04698449745774269,
      "pose_mae_dy": 0.03752628713846207,
      "pose_rmse_dtheta": 0.5174930691719055,
      "pose_rmse_dx": 0.12855929136276245,
      "pose_rmse_dy": 0.10341481119394302,
      "pose_rmse_mean": 0.24982240796089172,
      "rmse_dtheta": 0.05880323424935341,
      "rmse_dx": 0.021184749901294708,
      "rmse_dy": 0.0096047418192029,
      "rmse_mean": 0.029864244163036346,
      "rotation_flip": 0.01593625545501709,
      "sparse_tokens": 3936.0,
      "step": 5553,
      "turn_loss": 0.3086817264556885,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.258037539490801,
      "grad_norm": 0.5991942882537842,
      "learning_rate": 5.668358537053476e-06,
      "loss": 0.156,
      "mae_dtheta": 0.007218099199235439,
      "mae_dx": 0.002703567733988166,
      "mae_dy": 0.0007057939656078815,
      "pose_mae_dtheta": 0.053998224437236786,
      "pose_mae_dx": 0.021465640515089035,
      "pose_mae_dy": 0.010454271920025349,
      "pose_rmse_dtheta": 0.21679502725601196,
      "pose_rmse_dx": 0.09098968654870987,
      "pose_rmse_dy": 0.0315706804394722,
      "pose_rmse_mean": 0.11311846226453781,
      "rmse_dtheta": 0.02477019838988781,
      "rmse_dx": 0.009419532492756844,
      "rmse_dy": 0.0019590281881392,
      "rmse_mean": 0.012049587443470955,
      "rotation_flip": 0.0,
      "sparse_tokens": 32185.0,
      "step": 5554,
      "turn_loss": 0.0762159451842308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.25808399925664377,
      "grad_norm": 0.49925345182418823,
      "learning_rate": 5.667048160602564e-06,
      "loss": 0.1187,
      "mae_dtheta": 0.010482978075742722,
      "mae_dx": 0.0015588045353069901,
      "mae_dy": 0.002341518411412835,
      "pose_mae_dtheta": 0.07227496057748795,
      "pose_mae_dx": 0.020881420001387596,
      "pose_mae_dy": 0.03001529723405838,
      "pose_rmse_dtheta": 0.18350036442279816,
      "pose_rmse_dx": 0.05882437154650688,
      "pose_rmse_dy": 0.07542072981595993,
      "pose_rmse_mean": 0.10591515898704529,
      "rmse_dtheta": 0.02291610650718212,
      "rmse_dx": 0.005311653017997742,
      "rmse_dy": 0.005208379123359919,
      "rmse_mean": 0.011145379394292831,
      "rotation_flip": 0.004610065370798111,
      "sparse_tokens": 32121.0,
      "step": 5555,
      "turn_loss": 0.0884971022605896,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.25813045902248655,
      "grad_norm": 0.4189286231994629,
      "learning_rate": 5.665737737504616e-06,
      "loss": 0.0946,
      "mae_dtheta": 0.010155132971704006,
      "mae_dx": 0.001893512555398047,
      "mae_dy": 0.00027803139528259635,
      "pose_mae_dtheta": 0.07503297179937363,
      "pose_mae_dx": 0.014897975139319897,
      "pose_mae_dy": 0.0040988498367369175,
      "pose_rmse_dtheta": 0.2805126905441284,
      "pose_rmse_dx": 0.03284510597586632,
      "pose_rmse_dy": 0.008801409974694252,
      "pose_rmse_mean": 0.10738640278577805,
      "rmse_dtheta": 0.033344902098178864,
      "rmse_dx": 0.004737745504826307,
      "rmse_dy": 0.0005587961641140282,
      "rmse_mean": 0.012880481779575348,
      "rotation_flip": 0.0,
      "sparse_tokens": 32265.0,
      "step": 5556,
      "turn_loss": 0.0527961440384388,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2581769187883293,
      "grad_norm": 0.5006034970283508,
      "learning_rate": 5.664427267851271e-06,
      "loss": 0.1629,
      "mae_dtheta": 0.012217474170029163,
      "mae_dx": 0.002092046895995736,
      "mae_dy": 0.0031329940538853407,
      "pose_mae_dtheta": 0.08250685036182404,
      "pose_mae_dx": 0.029879000037908554,
      "pose_mae_dy": 0.035098426043987274,
      "pose_rmse_dtheta": 0.1858677715063095,
      "pose_rmse_dx": 0.08775019645690918,
      "pose_rmse_dy": 0.08605174720287323,
      "pose_rmse_mean": 0.11988991498947144,
      "rmse_dtheta": 0.023856142535805702,
      "rmse_dx": 0.008072026073932648,
      "rmse_dy": 0.006853997707366943,
      "rmse_mean": 0.012927388772368431,
      "rotation_flip": 0.0025906735099852085,
      "sparse_tokens": 32073.0,
      "step": 5557,
      "turn_loss": 0.09375786036252975,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22721.0,
      "epoch": 0.2582233785541721,
      "grad_norm": 0.4374309480190277,
      "learning_rate": 5.663116751734171e-06,
      "loss": 0.1175,
      "mae_dtheta": 0.03844478726387024,
      "mae_dx": 0.012935178354382515,
      "mae_dy": 0.006882952060550451,
      "pose_mae_dtheta": 0.29463669657707214,
      "pose_mae_dx": 0.1097169890999794,
      "pose_mae_dy": 0.08401130884885788,
      "pose_rmse_dtheta": 0.49263429641723633,
      "pose_rmse_dx": 0.2338424026966095,
      "pose_rmse_dy": 0.18188373744487762,
      "pose_rmse_mean": 0.30278682708740234,
      "rmse_dtheta": 0.0549311526119709,
      "rmse_dx": 0.02497408352792263,
      "rmse_dy": 0.01244369801133871,
      "rmse_mean": 0.030782978981733322,
      "rotation_flip": 0.02074688859283924,
      "sparse_tokens": 17911.0,
      "step": 5558,
      "turn_loss": 0.28639063239097595,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.2582698383200149,
      "grad_norm": 0.42081543803215027,
      "learning_rate": 5.6618061892449594e-06,
      "loss": 0.0841,
      "mae_dtheta": 0.023487865924835205,
      "mae_dx": 0.005788634996861219,
      "mae_dy": 0.00457628583535552,
      "pose_mae_dtheta": 0.1623699963092804,
      "pose_mae_dx": 0.06757128983736038,
      "pose_mae_dy": 0.08473062515258789,
      "pose_rmse_dtheta": 0.27935269474983215,
      "pose_rmse_dx": 0.14636412262916565,
      "pose_rmse_dy": 0.17227138578891754,
      "pose_rmse_mean": 0.1993294060230255,
      "rmse_dtheta": 0.038936205208301544,
      "rmse_dx": 0.015381641685962677,
      "rmse_dy": 0.007783366367220879,
      "rmse_mean": 0.020700406283140182,
      "rotation_flip": 0.004385964944958687,
      "sparse_tokens": 5088.0,
      "step": 5559,
      "turn_loss": 0.15045034885406494,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.25831629808585765,
      "grad_norm": 0.539618194103241,
      "learning_rate": 5.660495580475287e-06,
      "loss": 0.1244,
      "mae_dtheta": 0.009946604259312153,
      "mae_dx": 0.001522751059383154,
      "mae_dy": 0.002427436877042055,
      "pose_mae_dtheta": 0.07015123218297958,
      "pose_mae_dx": 0.01889641024172306,
      "pose_mae_dy": 0.02710752934217453,
      "pose_rmse_dtheta": 0.1387430727481842,
      "pose_rmse_dx": 0.05675109103322029,
      "pose_rmse_dy": 0.06185069680213928,
      "pose_rmse_mean": 0.08578161895275116,
      "rmse_dtheta": 0.020129460841417313,
      "rmse_dx": 0.004607828799635172,
      "rmse_dy": 0.0063599175773561,
      "rmse_mean": 0.010365735739469528,
      "rotation_flip": 0.005216095596551895,
      "sparse_tokens": 32105.0,
      "step": 5560,
      "turn_loss": 0.09073052555322647,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.25836275785170043,
      "grad_norm": 0.6715402007102966,
      "learning_rate": 5.659184925516802e-06,
      "loss": 0.0823,
      "mae_dtheta": 0.010131300427019596,
      "mae_dx": 0.0022976344916969538,
      "mae_dy": 0.0017321108607575297,
      "pose_mae_dtheta": 0.06965894252061844,
      "pose_mae_dx": 0.02442723698914051,
      "pose_mae_dy": 0.027271073311567307,
      "pose_rmse_dtheta": 0.16736114025115967,
      "pose_rmse_dx": 0.08640183508396149,
      "pose_rmse_dy": 0.0629686787724495,
      "pose_rmse_mean": 0.10557721555233002,
      "rmse_dtheta": 0.02129628136754036,
      "rmse_dx": 0.008774606510996819,
      "rmse_dy": 0.0034698208328336477,
      "rmse_mean": 0.011180236004292965,
      "rotation_flip": 0.0028503562789410353,
      "sparse_tokens": 32041.0,
      "step": 5561,
      "turn_loss": 0.06927382946014404,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2584092176175432,
      "grad_norm": 0.5255626440048218,
      "learning_rate": 5.657874224461163e-06,
      "loss": 0.151,
      "mae_dtheta": 0.015978343784809113,
      "mae_dx": 0.003933193627744913,
      "mae_dy": 0.005782760679721832,
      "pose_mae_dtheta": 0.1175643652677536,
      "pose_mae_dx": 0.052039049565792084,
      "pose_mae_dy": 0.05471197888255119,
      "pose_rmse_dtheta": 0.23417256772518158,
      "pose_rmse_dx": 0.12806741893291473,
      "pose_rmse_dy": 0.12134291231632233,
      "pose_rmse_mean": 0.161194309592247,
      "rmse_dtheta": 0.028402317315340042,
      "rmse_dx": 0.00952913612127304,
      "rmse_dy": 0.01149027980864048,
      "rmse_mean": 0.016473911702632904,
      "rotation_flip": 0.009669889695942402,
      "sparse_tokens": 32057.0,
      "step": 5562,
      "turn_loss": 0.15020601451396942,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.258455677383386,
      "grad_norm": 0.34679144620895386,
      "learning_rate": 5.656563477400026e-06,
      "loss": 0.08,
      "mae_dtheta": 0.009230933152139187,
      "mae_dx": 0.0017432022141292691,
      "mae_dy": 0.00217595137655735,
      "pose_mae_dtheta": 0.06405289471149445,
      "pose_mae_dx": 0.02187979221343994,
      "pose_mae_dy": 0.024847762659192085,
      "pose_rmse_dtheta": 0.16872942447662354,
      "pose_rmse_dx": 0.05974839627742767,
      "pose_rmse_dy": 0.05954878777265549,
      "pose_rmse_mean": 0.09600886702537537,
      "rmse_dtheta": 0.021764535456895828,
      "rmse_dx": 0.004952613264322281,
      "rmse_dy": 0.005124514456838369,
      "rmse_mean": 0.010613887570798397,
      "rotation_flip": 0.004961831960827112,
      "sparse_tokens": 32121.0,
      "step": 5563,
      "turn_loss": 0.08267369866371155,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.25850213714922876,
      "grad_norm": 0.5193202495574951,
      "learning_rate": 5.655252684425054e-06,
      "loss": 0.1238,
      "mae_dtheta": 0.019292039796710014,
      "mae_dx": 0.0032736705616116524,
      "mae_dy": 0.0060140592977404594,
      "pose_mae_dtheta": 0.1327451467514038,
      "pose_mae_dx": 0.03565807268023491,
      "pose_mae_dy": 0.05245942249894142,
      "pose_rmse_dtheta": 0.29780057072639465,
      "pose_rmse_dx": 0.07602795958518982,
      "pose_rmse_dy": 0.12240279465913773,
      "pose_rmse_mean": 0.16541044414043427,
      "rmse_dtheta": 0.03599385917186737,
      "rmse_dx": 0.007790056057274342,
      "rmse_dy": 0.012876907363533974,
      "rmse_mean": 0.01888694241642952,
      "rotation_flip": 0.008505070582032204,
      "sparse_tokens": 32105.0,
      "step": 5564,
      "turn_loss": 0.18446390330791473,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.25854859691507154,
      "grad_norm": 0.6452635526657104,
      "learning_rate": 5.653941845627908e-06,
      "loss": 0.1322,
      "mae_dtheta": 0.042522627860307693,
      "mae_dx": 0.0034744967706501484,
      "mae_dy": 0.0028201923705637455,
      "pose_mae_dtheta": 0.30441272258758545,
      "pose_mae_dx": 0.018062427639961243,
      "pose_mae_dy": 0.015416768379509449,
      "pose_rmse_dtheta": 0.5608255863189697,
      "pose_rmse_dx": 0.04497844725847244,
      "pose_rmse_dy": 0.043798815459012985,
      "pose_rmse_mean": 0.21653428673744202,
      "rmse_dtheta": 0.06661773473024368,
      "rmse_dx": 0.00810395646840334,
      "rmse_dy": 0.006942882668226957,
      "rmse_mean": 0.027221526950597763,
      "rotation_flip": 0.012285011820495129,
      "sparse_tokens": 6446.0,
      "step": 5565,
      "turn_loss": 0.15193434059619904,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2585950566809143,
      "grad_norm": 0.4386727511882782,
      "learning_rate": 5.65263096110026e-06,
      "loss": 0.0991,
      "mae_dtheta": 0.0070414189249277115,
      "mae_dx": 0.0013976203044876456,
      "mae_dy": 0.001528785564005375,
      "pose_mae_dtheta": 0.04779869690537453,
      "pose_mae_dx": 0.017601197585463524,
      "pose_mae_dy": 0.017598265781998634,
      "pose_rmse_dtheta": 0.13335980474948883,
      "pose_rmse_dx": 0.049567997455596924,
      "pose_rmse_dy": 0.04421379789710045,
      "pose_rmse_mean": 0.0757138729095459,
      "rmse_dtheta": 0.018269190564751625,
      "rmse_dx": 0.0043290299363434315,
      "rmse_dy": 0.0036844408605247736,
      "rmse_mean": 0.008760887198150158,
      "rotation_flip": 0.003992901649326086,
      "sparse_tokens": 32089.0,
      "step": 5566,
      "turn_loss": 0.05699588358402252,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2586415164467571,
      "grad_norm": 0.6088129281997681,
      "learning_rate": 5.651320030933777e-06,
      "loss": 0.0942,
      "mae_dtheta": 0.010783917270600796,
      "mae_dx": 0.0021839626133441925,
      "mae_dy": 0.0019036820158362389,
      "pose_mae_dtheta": 0.076112300157547,
      "pose_mae_dx": 0.028596337884664536,
      "pose_mae_dy": 0.026779232546687126,
      "pose_rmse_dtheta": 0.21378159523010254,
      "pose_rmse_dx": 0.07081282883882523,
      "pose_rmse_dy": 0.0687674805521965,
      "pose_rmse_mean": 0.11778730154037476,
      "rmse_dtheta": 0.026473917067050934,
      "rmse_dx": 0.0067681120708584785,
      "rmse_dy": 0.0045286184176802635,
      "rmse_mean": 0.012590216472744942,
      "rotation_flip": 0.0014917951775714755,
      "sparse_tokens": 32073.0,
      "step": 5567,
      "turn_loss": 0.10346416383981705,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.25868797621259987,
      "grad_norm": 0.4334583878517151,
      "learning_rate": 5.650009055220133e-06,
      "loss": 0.108,
      "mae_dtheta": 0.032122667878866196,
      "mae_dx": 0.008972073905169964,
      "mae_dy": 0.005733659490942955,
      "pose_mae_dtheta": 0.26061028242111206,
      "pose_mae_dx": 0.08691190183162689,
      "pose_mae_dy": 0.05461283400654793,
      "pose_rmse_dtheta": 0.501187801361084,
      "pose_rmse_dx": 0.19817815721035004,
      "pose_rmse_dy": 0.1197722926735878,
      "pose_rmse_mean": 0.2730461061000824,
      "rmse_dtheta": 0.05259096622467041,
      "rmse_dx": 0.018594715744256973,
      "rmse_dy": 0.012574668973684311,
      "rmse_mean": 0.02792011760175228,
      "rotation_flip": 0.010380622930824757,
      "sparse_tokens": 9057.0,
      "step": 5568,
      "turn_loss": 0.2319238930940628,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.25873443597844265,
      "grad_norm": 0.3817792236804962,
      "learning_rate": 5.648698034051009e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.03303904831409454,
      "mae_dx": 0.0127404211089015,
      "mae_dy": 0.006580575834959745,
      "pose_mae_dtheta": 0.27117645740509033,
      "pose_mae_dx": 0.10375897586345673,
      "pose_mae_dy": 0.10746624320745468,
      "pose_rmse_dtheta": 0.4799253046512604,
      "pose_rmse_dx": 0.2264227420091629,
      "pose_rmse_dy": 0.23892609775066376,
      "pose_rmse_mean": 0.31509140133857727,
      "rmse_dtheta": 0.050338517874479294,
      "rmse_dx": 0.026391129940748215,
      "rmse_dy": 0.012686909176409245,
      "rmse_mean": 0.029805518686771393,
      "rotation_flip": 0.019480518996715546,
      "sparse_tokens": 15589.0,
      "step": 5569,
      "turn_loss": 0.32961323857307434,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.2587808957442854,
      "grad_norm": 0.6078384518623352,
      "learning_rate": 5.647386967518084e-06,
      "loss": 0.128,
      "mae_dtheta": 0.03996337950229645,
      "mae_dx": 0.014086405746638775,
      "mae_dy": 0.0031199322547763586,
      "pose_mae_dtheta": 0.32811811566352844,
      "pose_mae_dx": 0.10796307772397995,
      "pose_mae_dy": 0.040271252393722534,
      "pose_rmse_dtheta": 0.5726773142814636,
      "pose_rmse_dx": 0.23653195798397064,
      "pose_rmse_dy": 0.09017262607812881,
      "pose_rmse_mean": 0.2997939884662628,
      "rmse_dtheta": 0.05981375649571419,
      "rmse_dx": 0.027537144720554352,
      "rmse_dy": 0.007152015343308449,
      "rmse_mean": 0.03150097280740738,
      "rotation_flip": 0.01576182059943676,
      "sparse_tokens": 10389.0,
      "step": 5570,
      "turn_loss": 0.24009008705615997,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.25882735551012825,
      "grad_norm": 0.591514527797699,
      "learning_rate": 5.646075855713039e-06,
      "loss": 0.1511,
      "mae_dtheta": 0.010135672986507416,
      "mae_dx": 0.0029534411150962114,
      "mae_dy": 0.0026234311517328024,
      "pose_mae_dtheta": 0.07708783447742462,
      "pose_mae_dx": 0.020399954169988632,
      "pose_mae_dy": 0.02205454371869564,
      "pose_rmse_dtheta": 0.2524021565914154,
      "pose_rmse_dx": 0.0566401332616806,
      "pose_rmse_dy": 0.0638604685664177,
      "pose_rmse_mean": 0.12430091947317123,
      "rmse_dtheta": 0.030030151829123497,
      "rmse_dx": 0.010532351210713387,
      "rmse_dy": 0.010021014139056206,
      "rmse_mean": 0.016861174255609512,
      "rotation_flip": 0.002109704539179802,
      "sparse_tokens": 32137.0,
      "step": 5571,
      "turn_loss": 0.115296371281147,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.25887381527597103,
      "grad_norm": 0.5389604568481445,
      "learning_rate": 5.644764698727564e-06,
      "loss": 0.1041,
      "mae_dtheta": 0.011628160253167152,
      "mae_dx": 0.0018610612023621798,
      "mae_dy": 0.0016913018189370632,
      "pose_mae_dtheta": 0.09187063574790955,
      "pose_mae_dx": 0.019372303038835526,
      "pose_mae_dy": 0.02464035525918007,
      "pose_rmse_dtheta": 0.28979364037513733,
      "pose_rmse_dx": 0.055705029517412186,
      "pose_rmse_dy": 0.07235182076692581,
      "pose_rmse_mean": 0.13928350806236267,
      "rmse_dtheta": 0.030855827033519745,
      "rmse_dx": 0.006142889149487019,
      "rmse_dy": 0.00453579006716609,
      "rmse_mean": 0.013844835571944714,
      "rotation_flip": 0.00206611561588943,
      "sparse_tokens": 32089.0,
      "step": 5572,
      "turn_loss": 0.07065923511981964,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.2589202750418138,
      "grad_norm": 0.9558858871459961,
      "learning_rate": 5.643453496653347e-06,
      "loss": 0.2443,
      "mae_dtheta": 0.03664437681436539,
      "mae_dx": 0.012064767070114613,
      "mae_dy": 0.006786281708627939,
      "pose_mae_dtheta": 0.26672685146331787,
      "pose_mae_dx": 0.08337651193141937,
      "pose_mae_dy": 0.08866564184427261,
      "pose_rmse_dtheta": 0.45387667417526245,
      "pose_rmse_dx": 0.19098885357379913,
      "pose_rmse_dy": 0.19909079372882843,
      "pose_rmse_mean": 0.2813187837600708,
      "rmse_dtheta": 0.05419487878680229,
      "rmse_dx": 0.024757882580161095,
      "rmse_dy": 0.011885879561305046,
      "rmse_mean": 0.030279546976089478,
      "rotation_flip": 0.014957264997065067,
      "sparse_tokens": 7690.0,
      "step": 5573,
      "turn_loss": 0.24000419676303864,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 29199.0,
      "epoch": 0.2589667348076566,
      "grad_norm": 0.48827821016311646,
      "learning_rate": 5.642142249582082e-06,
      "loss": 0.156,
      "mae_dtheta": 0.040441203862428665,
      "mae_dx": 0.012356303632259369,
      "mae_dy": 0.0049959649331867695,
      "pose_mae_dtheta": 0.3176293969154358,
      "pose_mae_dx": 0.09844225645065308,
      "pose_mae_dy": 0.055322013795375824,
      "pose_rmse_dtheta": 0.5332764387130737,
      "pose_rmse_dx": 0.22671157121658325,
      "pose_rmse_dy": 0.12477631121873856,
      "pose_rmse_mean": 0.2949214577674866,
      "rmse_dtheta": 0.058803021907806396,
      "rmse_dx": 0.025198135524988174,
      "rmse_dy": 0.01000426895916462,
      "rmse_mean": 0.03133514150977135,
      "rotation_flip": 0.010408922098577023,
      "sparse_tokens": 23731.0,
      "step": 5574,
      "turn_loss": 0.3194085359573364,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.25901319457349936,
      "grad_norm": 0.5287488102912903,
      "learning_rate": 5.640830957605466e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.011661866679787636,
      "mae_dx": 0.0020362825598567724,
      "mae_dy": 0.0035085370764136314,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5287488698959351,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.24159240722656,
      "model/head/act_norm_mean": 101.72474747474747,
      "model/head/act_norm_min": 70.82365417480469,
      "model/head/act_over_embed": 69.90619882673703,
      "model/head/grad_frac": 0.11195157468318939,
      "model/head/grad_norm": 0.05919427052140236,
      "model/head/grad_zero_frac": 0.00017608582857064903,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7046391650883839,
      "model/head/update_ratio": 0.0010123542742803693,
      "model/head/weight_delta": 8.679774284362793,
      "model/head/weight_delta_rel": 0.15226894617080688,
      "model/head/weight_norm": 58.47188949584961,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42054617404937744,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4204769566048324,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4203962981700897,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28895570114613023,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08518428355455399,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04504109546542168,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5355362697963801,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014562929281964898,
      "model/modality_embedder.encoders.pose/weight_delta": 2.827920913696289,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09239698946475983,
      "model/modality_embedder.encoders.pose/weight_norm": 30.92859649658203,
      "model/modality_embedder/grad_frac": 0.08518428355455399,
      "model/modality_embedder/grad_norm": 0.04504109546542168,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5355362697963801,
      "model/modality_embedder/update_ratio": 0.0014562929281964898,
      "model/modality_embedder/weight_delta": 2.827920913696289,
      "model/modality_embedder/weight_delta_rel": 0.09239698946475983,
      "model/modality_embedder/weight_norm": 30.92859649658203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.09488677978516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.841517857142858,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.03310775756836,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.696904917087943,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09784385561943054,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05173482745885849,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018583068158477545,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.181044816970825,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07947859168052673,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.839765548706055,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.81461334228516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.82220769199936,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.315423965454102,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.37084415296422,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10619758814573288,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0561518557369709,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018989250529557467,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.763472080230713,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09572882950305939,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.570337295532227,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.80322265625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.71019470498637,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.366230010986328,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.668286503901793,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10712025314569473,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05663971230387688,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00185529759619385,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.976909875869751,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.09995906054973602,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.528640747070312,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.54578399658203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.586081549623216,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.312785148620605,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.957413505865574,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10846412926912308,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0573502853512764,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019247340969741344,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.541282892227173,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08684898912906647,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.796472549438477,
      "model/normalizer/grad_frac": 0.42970147728919983,
      "model/normalizer/grad_norm": 0.22720417380332947,
      "model/normalizer/grad_zero_frac": 0.00012526426871772856,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002896781312301755,
      "model/normalizer/weight_delta": 5.387152671813965,
      "model/normalizer/weight_delta_rel": 0.069383405148983,
      "model/normalizer/weight_norm": 78.43331909179688,
      "pose_mae_dtheta": 0.0701504573225975,
      "pose_mae_dx": 0.03419411554932594,
      "pose_mae_dy": 0.035391658544540405,
      "pose_rmse_dtheta": 0.13441474735736847,
      "pose_rmse_dx": 0.08092571049928665,
      "pose_rmse_dy": 0.07332680374383926,
      "pose_rmse_mean": 0.096222423017025,
      "rmse_dtheta": 0.02133028768002987,
      "rmse_dx": 0.005268006585538387,
      "rmse_dy": 0.006964991334825754,
      "rmse_mean": 0.011187762022018433,
      "rotation_flip": 0.004662004765123129,
      "sparse_tokens": 32089.0,
      "step": 5575,
      "turn_loss": 0.09290087968111038,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.25905965433934214,
      "grad_norm": 0.43013328313827515,
      "learning_rate": 5.639519620815195e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.011726517230272293,
      "mae_dx": 0.002866071881726384,
      "mae_dy": 0.0041205380111932755,
      "pose_mae_dtheta": 0.07894536107778549,
      "pose_mae_dx": 0.03732108697295189,
      "pose_mae_dy": 0.034850943833589554,
      "pose_rmse_dtheta": 0.20311704277992249,
      "pose_rmse_dx": 0.10232702642679214,
      "pose_rmse_dy": 0.08073650300502777,
      "pose_rmse_mean": 0.12872686982154846,
      "rmse_dtheta": 0.02501329965889454,
      "rmse_dx": 0.007097118999809027,
      "rmse_dy": 0.0095140989869833,
      "rmse_mean": 0.013874839060008526,
      "rotation_flip": 0.005005362909287214,
      "sparse_tokens": 32105.0,
      "step": 5576,
      "turn_loss": 0.12552715837955475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2591061141051849,
      "grad_norm": 0.608224093914032,
      "learning_rate": 5.638208239302975e-06,
      "loss": 0.075,
      "mae_dtheta": 0.008120454847812653,
      "mae_dx": 0.0011622563470155,
      "mae_dy": 0.0019255599472671747,
      "pose_mae_dtheta": 0.05186901241540909,
      "pose_mae_dx": 0.01987004280090332,
      "pose_mae_dy": 0.026713037863373756,
      "pose_rmse_dtheta": 0.09646716713905334,
      "pose_rmse_dx": 0.05110257863998413,
      "pose_rmse_dy": 0.05878356099128723,
      "pose_rmse_mean": 0.0687844380736351,
      "rmse_dtheta": 0.015563283115625381,
      "rmse_dx": 0.0036531565710902214,
      "rmse_dy": 0.004286588169634342,
      "rmse_mean": 0.007834343239665031,
      "rotation_flip": 0.0011843664105981588,
      "sparse_tokens": 32073.0,
      "step": 5577,
      "turn_loss": 0.0622464194893837,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31369.0,
      "epoch": 0.2591525738710277,
      "grad_norm": 0.614689826965332,
      "learning_rate": 5.63689681316051e-06,
      "loss": 0.1863,
      "mae_dtheta": 0.03354974091053009,
      "mae_dx": 0.011617746204137802,
      "mae_dy": 0.005291666369885206,
      "pose_mae_dtheta": 0.2542305290699005,
      "pose_mae_dx": 0.09026595950126648,
      "pose_mae_dy": 0.06231896951794624,
      "pose_rmse_dtheta": 0.46792519092559814,
      "pose_rmse_dx": 0.20289672911167145,
      "pose_rmse_dy": 0.13023348152637482,
      "pose_rmse_mean": 0.26701846718788147,
      "rmse_dtheta": 0.05206125229597092,
      "rmse_dx": 0.023967938497662544,
      "rmse_dy": 0.009831164963543415,
      "rmse_mean": 0.028620120137929916,
      "rotation_flip": 0.012978585436940193,
      "sparse_tokens": 25949.0,
      "step": 5578,
      "turn_loss": 0.2699032127857208,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.25919903363687047,
      "grad_norm": 0.38114944100379944,
      "learning_rate": 5.635585342479508e-06,
      "loss": 0.0898,
      "mae_dtheta": 0.008831807412207127,
      "mae_dx": 0.0013836462749168277,
      "mae_dy": 0.0016179506201297045,
      "pose_mae_dtheta": 0.05897943675518036,
      "pose_mae_dx": 0.016906462609767914,
      "pose_mae_dy": 0.01626897044479847,
      "pose_rmse_dtheta": 0.1970498114824295,
      "pose_rmse_dx": 0.042519114911556244,
      "pose_rmse_dy": 0.03836798667907715,
      "pose_rmse_mean": 0.09264563769102097,
      "rmse_dtheta": 0.024716878309845924,
      "rmse_dx": 0.003693083068355918,
      "rmse_dy": 0.003839705139398575,
      "rmse_mean": 0.01074988953769207,
      "rotation_flip": 0.003703703638166189,
      "sparse_tokens": 32153.0,
      "step": 5579,
      "turn_loss": 0.07043467462062836,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.25924549340271325,
      "grad_norm": 0.4340766370296478,
      "learning_rate": 5.634273827351682e-06,
      "loss": 0.1159,
      "mae_dtheta": 0.006552938837558031,
      "mae_dx": 0.0016393093392252922,
      "mae_dy": 0.0015559075400233269,
      "pose_mae_dtheta": 0.04604712501168251,
      "pose_mae_dx": 0.020728284493088722,
      "pose_mae_dy": 0.018493086099624634,
      "pose_rmse_dtheta": 0.15967798233032227,
      "pose_rmse_dx": 0.05951873958110809,
      "pose_rmse_dy": 0.048004910349845886,
      "pose_rmse_mean": 0.08906721323728561,
      "rmse_dtheta": 0.01859033852815628,
      "rmse_dx": 0.005357485264539719,
      "rmse_dy": 0.0040604183450341225,
      "rmse_mean": 0.009336080402135849,
      "rotation_flip": 0.002555910497903824,
      "sparse_tokens": 32041.0,
      "step": 5580,
      "turn_loss": 0.06199149042367935,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.259291953168556,
      "grad_norm": 0.5133000016212463,
      "learning_rate": 5.632962267868747e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.008915417827665806,
      "mae_dx": 0.0017099196556955576,
      "mae_dy": 0.002108894055709243,
      "pose_mae_dtheta": 0.05831519514322281,
      "pose_mae_dx": 0.021420298144221306,
      "pose_mae_dy": 0.022562677040696144,
      "pose_rmse_dtheta": 0.1475326418876648,
      "pose_rmse_dx": 0.06081888824701309,
      "pose_rmse_dy": 0.04961930587887764,
      "pose_rmse_mean": 0.08599027991294861,
      "rmse_dtheta": 0.020190147683024406,
      "rmse_dx": 0.005900141317397356,
      "rmse_dy": 0.0046802060678601265,
      "rmse_mean": 0.010256832465529442,
      "rotation_flip": 0.0036463080905377865,
      "sparse_tokens": 32073.0,
      "step": 5581,
      "turn_loss": 0.07386991381645203,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2593384129343988,
      "grad_norm": 0.35512039065361023,
      "learning_rate": 5.631650664122421e-06,
      "loss": 0.0951,
      "mae_dtheta": 0.009737620130181313,
      "mae_dx": 0.003426187438890338,
      "mae_dy": 0.0027580971363931894,
      "pose_mae_dtheta": 0.06367059797048569,
      "pose_mae_dx": 0.036207180470228195,
      "pose_mae_dy": 0.03640460968017578,
      "pose_rmse_dtheta": 0.13067202270030975,
      "pose_rmse_dx": 0.10955926775932312,
      "pose_rmse_dy": 0.11020514369010925,
      "pose_rmse_mean": 0.11681215465068817,
      "rmse_dtheta": 0.020172016695141792,
      "rmse_dx": 0.011660718359053135,
      "rmse_dy": 0.006930583622306585,
      "rmse_mean": 0.012921106070280075,
      "rotation_flip": 0.005044625606387854,
      "sparse_tokens": 32105.0,
      "step": 5582,
      "turn_loss": 0.1434597671031952,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.2593848727002416,
      "grad_norm": 0.6110280156135559,
      "learning_rate": 5.630339016204426e-06,
      "loss": 0.1484,
      "mae_dtheta": 0.029281096532940865,
      "mae_dx": 0.010916242375969887,
      "mae_dy": 0.006278779823333025,
      "pose_mae_dtheta": 0.2244228571653366,
      "pose_mae_dx": 0.08477780967950821,
      "pose_mae_dy": 0.09220317751169205,
      "pose_rmse_dtheta": 0.4123581349849701,
      "pose_rmse_dx": 0.1703254133462906,
      "pose_rmse_dy": 0.1732906997203827,
      "pose_rmse_mean": 0.2519914507865906,
      "rmse_dtheta": 0.046442411839962006,
      "rmse_dx": 0.02344711869955063,
      "rmse_dy": 0.010334105230867863,
      "rmse_mean": 0.026741212233901024,
      "rotation_flip": 0.011217948980629444,
      "sparse_tokens": 13349.0,
      "step": 5583,
      "turn_loss": 0.23110908269882202,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.25943133246608435,
      "grad_norm": 0.4752840995788574,
      "learning_rate": 5.629027324206484e-06,
      "loss": 0.1265,
      "mae_dtheta": 0.008089995011687279,
      "mae_dx": 0.0017111166380345821,
      "mae_dy": 0.0011262553744018078,
      "pose_mae_dtheta": 0.05834838002920151,
      "pose_mae_dx": 0.017310326918959618,
      "pose_mae_dy": 0.019306760281324387,
      "pose_rmse_dtheta": 0.1360858678817749,
      "pose_rmse_dx": 0.04402870684862137,
      "pose_rmse_dy": 0.04767229035496712,
      "pose_rmse_mean": 0.0759289562702179,
      "rmse_dtheta": 0.01816500909626484,
      "rmse_dx": 0.005358836147934198,
      "rmse_dy": 0.002338583581149578,
      "rmse_mean": 0.008620809763669968,
      "rotation_flip": 0.004460303112864494,
      "sparse_tokens": 32137.0,
      "step": 5584,
      "turn_loss": 0.05918217822909355,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37313.0,
      "epoch": 0.25947779223192713,
      "grad_norm": 0.5669179558753967,
      "learning_rate": 5.627715588220325e-06,
      "loss": 0.1788,
      "mae_dtheta": 0.035665832459926605,
      "mae_dx": 0.01093983743339777,
      "mae_dy": 0.006367911119014025,
      "pose_mae_dtheta": 0.2762922942638397,
      "pose_mae_dx": 0.0951073095202446,
      "pose_mae_dy": 0.07077987492084503,
      "pose_rmse_dtheta": 0.47907376289367676,
      "pose_rmse_dx": 0.2079700231552124,
      "pose_rmse_dy": 0.17558297514915466,
      "pose_rmse_mean": 0.28754228353500366,
      "rmse_dtheta": 0.05489443987607956,
      "rmse_dx": 0.02254500985145569,
      "rmse_dy": 0.015339527279138565,
      "rmse_mean": 0.030926328152418137,
      "rotation_flip": 0.014898688532412052,
      "sparse_tokens": 29813.0,
      "step": 5585,
      "turn_loss": 0.3191450834274292,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.2595242519977699,
      "grad_norm": 0.6651625037193298,
      "learning_rate": 5.626403808337677e-06,
      "loss": 0.1558,
      "mae_dtheta": 0.0347006656229496,
      "mae_dx": 0.013853990472853184,
      "mae_dy": 0.007197188679128885,
      "pose_mae_dtheta": 0.2735389173030853,
      "pose_mae_dx": 0.1184094101190567,
      "pose_mae_dy": 0.11608568578958511,
      "pose_rmse_dtheta": 0.45040249824523926,
      "pose_rmse_dx": 0.23498325049877167,
      "pose_rmse_dy": 0.21700461208820343,
      "pose_rmse_mean": 0.3007968068122864,
      "rmse_dtheta": 0.049214549362659454,
      "rmse_dx": 0.027299540117383003,
      "rmse_dy": 0.011299348436295986,
      "rmse_mean": 0.029271146282553673,
      "rotation_flip": 0.007849293760955334,
      "sparse_tokens": 10911.0,
      "step": 5586,
      "turn_loss": 0.28769320249557495,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.25957071176361274,
      "grad_norm": 0.7746410369873047,
      "learning_rate": 5.625091984650273e-06,
      "loss": 0.1659,
      "mae_dtheta": 0.036794330924749374,
      "mae_dx": 0.016485119238495827,
      "mae_dy": 0.0057493033818900585,
      "pose_mae_dtheta": 0.29140669107437134,
      "pose_mae_dx": 0.1255805492401123,
      "pose_mae_dy": 0.08275048434734344,
      "pose_rmse_dtheta": 0.504408061504364,
      "pose_rmse_dx": 0.25362759828567505,
      "pose_rmse_dy": 0.20367293059825897,
      "pose_rmse_mean": 0.32056954503059387,
      "rmse_dtheta": 0.05397382378578186,
      "rmse_dx": 0.029915010556578636,
      "rmse_dy": 0.011143629439175129,
      "rmse_mean": 0.0316774919629097,
      "rotation_flip": 0.024038461968302727,
      "sparse_tokens": 7243.0,
      "step": 5587,
      "turn_loss": 0.2590635418891907,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2596171715294555,
      "grad_norm": 0.4898344874382019,
      "learning_rate": 5.623780117249853e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.012670136988162994,
      "mae_dx": 0.0034725985024124384,
      "mae_dy": 0.00346094137057662,
      "pose_mae_dtheta": 0.08638184517621994,
      "pose_mae_dx": 0.033770471811294556,
      "pose_mae_dy": 0.02984553761780262,
      "pose_rmse_dtheta": 0.23351944983005524,
      "pose_rmse_dx": 0.09932640939950943,
      "pose_rmse_dy": 0.07163821905851364,
      "pose_rmse_mean": 0.13482803106307983,
      "rmse_dtheta": 0.02814708836376667,
      "rmse_dx": 0.010534628294408321,
      "rmse_dy": 0.007946296595036983,
      "rmse_mean": 0.015542671084403992,
      "rotation_flip": 0.005633802618831396,
      "sparse_tokens": 32105.0,
      "step": 5588,
      "turn_loss": 0.10891924053430557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2596636312952983,
      "grad_norm": 0.5432918071746826,
      "learning_rate": 5.622468206228154e-06,
      "loss": 0.1122,
      "mae_dtheta": 0.010594846680760384,
      "mae_dx": 0.0017079835524782538,
      "mae_dy": 0.002691004890948534,
      "pose_mae_dtheta": 0.0733393207192421,
      "pose_mae_dx": 0.022907963022589684,
      "pose_mae_dy": 0.03506365790963173,
      "pose_rmse_dtheta": 0.16332943737506866,
      "pose_rmse_dx": 0.0634211003780365,
      "pose_rmse_dy": 0.09831347316503525,
      "pose_rmse_mean": 0.10835467278957367,
      "rmse_dtheta": 0.021184973418712616,
      "rmse_dx": 0.00628206180408597,
      "rmse_dy": 0.007869060151278973,
      "rmse_mean": 0.011778699234127998,
      "rotation_flip": 0.005679513327777386,
      "sparse_tokens": 32041.0,
      "step": 5589,
      "turn_loss": 0.0942554920911789,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.25971009106114107,
      "grad_norm": 0.3457464277744293,
      "learning_rate": 5.62115625167692e-06,
      "loss": 0.0905,
      "mae_dtheta": 0.007627745624631643,
      "mae_dx": 0.0016927790129557252,
      "mae_dy": 0.0009315820643678308,
      "pose_mae_dtheta": 0.05201776325702667,
      "pose_mae_dx": 0.0168440043926239,
      "pose_mae_dy": 0.012288789264857769,
      "pose_rmse_dtheta": 0.19499965012073517,
      "pose_rmse_dx": 0.06661992520093918,
      "pose_rmse_dy": 0.033975496888160706,
      "pose_rmse_mean": 0.09853168576955795,
      "rmse_dtheta": 0.022727888077497482,
      "rmse_dx": 0.006379087455570698,
      "rmse_dy": 0.0022548167034983635,
      "rmse_mean": 0.01045393105596304,
      "rotation_flip": 0.009103977121412754,
      "sparse_tokens": 32153.0,
      "step": 5590,
      "turn_loss": 0.049683909863233566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.25975655082698385,
      "grad_norm": 0.5423132181167603,
      "learning_rate": 5.619844253687896e-06,
      "loss": 0.1333,
      "mae_dtheta": 0.0484221987426281,
      "mae_dx": 0.011412953957915306,
      "mae_dy": 0.0021386779844760895,
      "pose_mae_dtheta": 0.3616884648799896,
      "pose_mae_dx": 0.0935206487774849,
      "pose_mae_dy": 0.04335804283618927,
      "pose_rmse_dtheta": 0.591335654258728,
      "pose_rmse_dx": 0.26808279752731323,
      "pose_rmse_dy": 0.11011698096990585,
      "pose_rmse_mean": 0.3231784701347351,
      "rmse_dtheta": 0.06623827666044235,
      "rmse_dx": 0.024489691480994225,
      "rmse_dy": 0.004713407717645168,
      "rmse_mean": 0.03181379288434982,
      "rotation_flip": 0.027149321511387825,
      "sparse_tokens": 3945.0,
      "step": 5591,
      "turn_loss": 0.303631991147995,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.2598030105928266,
      "grad_norm": 1.380898356437683,
      "learning_rate": 5.61853221235283e-06,
      "loss": 0.2854,
      "mae_dtheta": 0.03146738559007645,
      "mae_dx": 0.011395617388188839,
      "mae_dy": 0.004836412146687508,
      "pose_mae_dtheta": 0.23628616333007812,
      "pose_mae_dx": 0.09654752165079117,
      "pose_mae_dy": 0.06796842813491821,
      "pose_rmse_dtheta": 0.41921475529670715,
      "pose_rmse_dx": 0.22150208055973053,
      "pose_rmse_dy": 0.16267013549804688,
      "pose_rmse_mean": 0.2677956819534302,
      "rmse_dtheta": 0.04796285927295685,
      "rmse_dx": 0.02408268302679062,
      "rmse_dy": 0.00930424127727747,
      "rmse_mean": 0.027116594836115837,
      "rotation_flip": 0.025695931166410446,
      "sparse_tokens": 9309.0,
      "step": 5592,
      "turn_loss": 0.2494073212146759,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.2598494703586694,
      "grad_norm": 0.49420613050460815,
      "learning_rate": 5.617220127763474e-06,
      "loss": 0.1042,
      "mae_dtheta": 0.028825044631958008,
      "mae_dx": 0.009541211649775505,
      "mae_dy": 0.007677074056118727,
      "pose_mae_dtheta": 0.23798035085201263,
      "pose_mae_dx": 0.07970216870307922,
      "pose_mae_dy": 0.10658697038888931,
      "pose_rmse_dtheta": 0.41234898567199707,
      "pose_rmse_dx": 0.1634468138217926,
      "pose_rmse_dy": 0.19004428386688232,
      "pose_rmse_mean": 0.2552800178527832,
      "rmse_dtheta": 0.043512191623449326,
      "rmse_dx": 0.02183288335800171,
      "rmse_dy": 0.011511058546602726,
      "rmse_mean": 0.025618713349103928,
      "rotation_flip": 0.017716536298394203,
      "sparse_tokens": 7908.0,
      "step": 5593,
      "turn_loss": 0.25554385781288147,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2598959301245122,
      "grad_norm": 0.6069648265838623,
      "learning_rate": 5.615908000011584e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.010903791524469852,
      "mae_dx": 0.002591195981949568,
      "mae_dy": 0.002564480295404792,
      "pose_mae_dtheta": 0.08292046189308167,
      "pose_mae_dx": 0.0335371196269989,
      "pose_mae_dy": 0.03824446722865105,
      "pose_rmse_dtheta": 0.17899751663208008,
      "pose_rmse_dx": 0.09676904231309891,
      "pose_rmse_dy": 0.10350287705659866,
      "pose_rmse_mean": 0.12642315030097961,
      "rmse_dtheta": 0.021741600707173347,
      "rmse_dx": 0.00811611209064722,
      "rmse_dy": 0.006340070627629757,
      "rmse_mean": 0.012065928429365158,
      "rotation_flip": 0.002123142359778285,
      "sparse_tokens": 32089.0,
      "step": 5594,
      "turn_loss": 0.11936329305171967,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.25994238989035495,
      "grad_norm": 0.3826362192630768,
      "learning_rate": 5.614595829188917e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.012478028424084187,
      "mae_dx": 0.0017397475894540548,
      "mae_dy": 0.002788667334243655,
      "pose_mae_dtheta": 0.07901570945978165,
      "pose_mae_dx": 0.023329105228185654,
      "pose_mae_dy": 0.02931739017367363,
      "pose_rmse_dtheta": 0.20154660940170288,
      "pose_rmse_dx": 0.05700915306806564,
      "pose_rmse_dy": 0.05783584341406822,
      "pose_rmse_mean": 0.10546387732028961,
      "rmse_dtheta": 0.02621571160852909,
      "rmse_dx": 0.005223384127020836,
      "rmse_dy": 0.0055099292658269405,
      "rmse_mean": 0.012316341511905193,
      "rotation_flip": 0.006934812758117914,
      "sparse_tokens": 32089.0,
      "step": 5595,
      "turn_loss": 0.10314550250768661,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.25998884965619773,
      "grad_norm": 0.4133879244327545,
      "learning_rate": 5.6132836153872335e-06,
      "loss": 0.0915,
      "mae_dtheta": 0.007418282330036163,
      "mae_dx": 0.001408225973136723,
      "mae_dy": 0.00182011176366359,
      "pose_mae_dtheta": 0.04965691268444061,
      "pose_mae_dx": 0.017428260296583176,
      "pose_mae_dy": 0.02470030076801777,
      "pose_rmse_dtheta": 0.10776680707931519,
      "pose_rmse_dx": 0.05116068944334984,
      "pose_rmse_dy": 0.06359481066465378,
      "pose_rmse_mean": 0.07417410612106323,
      "rmse_dtheta": 0.016089482232928276,
      "rmse_dx": 0.004585242364555597,
      "rmse_dy": 0.004066898953169584,
      "rmse_mean": 0.00824720785021782,
      "rotation_flip": 0.00929368007928133,
      "sparse_tokens": 32073.0,
      "step": 5596,
      "turn_loss": 0.06581861525774002,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.2600353094220405,
      "grad_norm": 0.5753596425056458,
      "learning_rate": 5.6119713586982985e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.03932446613907814,
      "mae_dx": 0.013645682483911514,
      "mae_dy": 0.006452155765146017,
      "pose_mae_dtheta": 0.31598836183547974,
      "pose_mae_dx": 0.1056932732462883,
      "pose_mae_dy": 0.07489736378192902,
      "pose_rmse_dtheta": 0.5370002388954163,
      "pose_rmse_dx": 0.24554404616355896,
      "pose_rmse_dy": 0.1847389042377472,
      "pose_rmse_mean": 0.3224277198314667,
      "rmse_dtheta": 0.05648473650217056,
      "rmse_dx": 0.02675299346446991,
      "rmse_dy": 0.012893718667328358,
      "rmse_mean": 0.03204381838440895,
      "rotation_flip": 0.01598401553928852,
      "sparse_tokens": 16529.0,
      "step": 5597,
      "turn_loss": 0.34809261560440063,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2600817691878833,
      "grad_norm": 0.4461376965045929,
      "learning_rate": 5.610659059213877e-06,
      "loss": 0.0879,
      "mae_dtheta": 0.00649110646918416,
      "mae_dx": 0.0010051187127828598,
      "mae_dy": 0.0007931666914373636,
      "pose_mae_dtheta": 0.04765472933650017,
      "pose_mae_dx": 0.011509254574775696,
      "pose_mae_dy": 0.014431990683078766,
      "pose_rmse_dtheta": 0.17626003921031952,
      "pose_rmse_dx": 0.03343363106250763,
      "pose_rmse_dy": 0.04061002656817436,
      "pose_rmse_mean": 0.0834345668554306,
      "rmse_dtheta": 0.021388882771134377,
      "rmse_dx": 0.0035928203724324703,
      "rmse_dy": 0.00218101404607296,
      "rmse_mean": 0.009054239839315414,
      "rotation_flip": 0.0012755101779475808,
      "sparse_tokens": 32089.0,
      "step": 5598,
      "turn_loss": 0.037159718573093414,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.26012822895372606,
      "grad_norm": 0.3925013542175293,
      "learning_rate": 5.609346717025738e-06,
      "loss": 0.0944,
      "mae_dtheta": 0.01261982973664999,
      "mae_dx": 0.0020009083673357964,
      "mae_dy": 0.0020551346242427826,
      "pose_mae_dtheta": 0.08488008379936218,
      "pose_mae_dx": 0.021929219365119934,
      "pose_mae_dy": 0.024733737111091614,
      "pose_rmse_dtheta": 0.2513670325279236,
      "pose_rmse_dx": 0.06361691653728485,
      "pose_rmse_dy": 0.06570076942443848,
      "pose_rmse_mean": 0.12689492106437683,
      "rmse_dtheta": 0.02981780841946602,
      "rmse_dx": 0.005526916589587927,
      "rmse_dy": 0.005327475257217884,
      "rmse_mean": 0.01355739962309599,
      "rotation_flip": 0.005973715800791979,
      "sparse_tokens": 32153.0,
      "step": 5599,
      "turn_loss": 0.09928850084543228,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36875.0,
      "epoch": 0.26017468871956884,
      "grad_norm": 0.6368290781974792,
      "learning_rate": 5.608034332225658e-06,
      "loss": 0.1874,
      "mae_dtheta": 0.03764782100915909,
      "mae_dx": 0.012821643613278866,
      "mae_dy": 0.006855010520666838,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6368291974067688,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 154.587158203125,
      "model/head/act_norm_mean": 105.34421258223684,
      "model/head/act_norm_min": 59.910560607910156,
      "model/head/act_over_embed": 72.39352913456995,
      "model/head/grad_frac": 0.10621459782123566,
      "model/head/grad_norm": 0.06764055788516998,
      "model/head/grad_zero_frac": 0.00013833049160894006,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6938390899122807,
      "model/head/update_ratio": 0.0011567259207367897,
      "model/head/weight_delta": 8.694746971130371,
      "model/head/weight_delta_rel": 0.15253160893917084,
      "model/head/weight_norm": 58.47587203979492,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42058631777763367,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42058631777763367,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42058631777763367,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28903085516793464,
      "model/modality_embedder.encoders.pose/grad_frac": 0.058230455964803696,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03708285465836525,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011989579070359468,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8336288928985596,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09258348494768143,
      "model/modality_embedder.encoders.pose/weight_norm": 30.929237365722656,
      "model/modality_embedder/grad_frac": 0.058230455964803696,
      "model/modality_embedder/grad_norm": 0.03708285465836525,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0011989579070359468,
      "model/modality_embedder/weight_delta": 2.8336288928985596,
      "model/modality_embedder/weight_delta_rel": 0.09258348494768143,
      "model/modality_embedder/weight_norm": 30.929237365722656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.26691436767578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.173637218045112,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.178849220275879,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.925140451250419,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08927472680807114,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05685275420546532,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 9.582795610185713e-05,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020420688670128584,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.1865923404693604,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07968074083328247,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.840763092041016,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.1008071899414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.989400584795323,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.809776306152344,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.485740674178132,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08367659151554108,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05328769609332085,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018019318813458085,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.770765542984009,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09598148614168167,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.57253646850586,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.90607452392578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.629897225703147,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.990119934082031,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.613105324381518,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07909500598907471,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05037000775337219,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016497717006132007,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.9853463172912598,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10024233907461166,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.53150177001953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.60115051269531,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.544288237956,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.751266479492188,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.92869275081271,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07869867235422134,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0501176118850708,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016819037264212966,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.548295736312866,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08708865195512772,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.798145294189453,
      "model/normalizer/grad_frac": 0.33476722240448,
      "model/normalizer/grad_norm": 0.21318954229354858,
      "model/normalizer/grad_zero_frac": 0.00015362599515356123,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0027180109173059464,
      "model/normalizer/weight_delta": 5.401705741882324,
      "model/normalizer/weight_delta_rel": 0.06957083940505981,
      "model/normalizer/weight_norm": 78.43586730957031,
      "pose_mae_dtheta": 0.31059443950653076,
      "pose_mae_dx": 0.10208205133676529,
      "pose_mae_dy": 0.07905345410108566,
      "pose_rmse_dtheta": 0.5412401556968689,
      "pose_rmse_dx": 0.2328551560640335,
      "pose_rmse_dy": 0.17664512991905212,
      "pose_rmse_mean": 0.3169134855270386,
      "rmse_dtheta": 0.05643696337938309,
      "rmse_dx": 0.025896362960338593,
      "rmse_dy": 0.014356367290019989,
      "rmse_mean": 0.03222990036010742,
      "rotation_flip": 0.008573178201913834,
      "sparse_tokens": 28658.0,
      "step": 5600,
      "turn_loss": 0.3103421628475189,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "epoch": 0.26017468871956884,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31696897745132446,
      "eval_objectnav_nopose_mae_dtheta": 0.04024868831038475,
      "eval_objectnav_nopose_mae_dx": 0.013668430969119072,
      "eval_objectnav_nopose_mae_dy": 0.005283845588564873,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3220879137516022,
      "eval_objectnav_nopose_pose_mae_dx": 0.11083611100912094,
      "eval_objectnav_nopose_pose_mae_dy": 0.05883312597870827,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5427964329719543,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24204155802726746,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13993299007415771,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30825698375701904,
      "eval_objectnav_nopose_rmse_dtheta": 0.058003321290016174,
      "eval_objectnav_nopose_rmse_dx": 0.026623399928212166,
      "eval_objectnav_nopose_rmse_dy": 0.010911349207162857,
      "eval_objectnav_nopose_rmse_mean": 0.031846024096012115,
      "eval_objectnav_nopose_rotation_flip": 0.016245128586888313,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31696897745132446,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 5600
    },
    {
      "epoch": 0.26017468871956884,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28235143423080444,
      "eval_objectnav_pose_mae_dtheta": 0.03560531511902809,
      "eval_objectnav_pose_mae_dx": 0.012010294012725353,
      "eval_objectnav_pose_mae_dy": 0.005014169495552778,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2689439356327057,
      "eval_objectnav_pose_pose_mae_dx": 0.09360195696353912,
      "eval_objectnav_pose_pose_mae_dy": 0.052682772278785706,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46967437863349915,
      "eval_objectnav_pose_pose_rmse_dx": 0.2170853167772293,
      "eval_objectnav_pose_pose_rmse_dy": 0.12705691158771515,
      "eval_objectnav_pose_pose_rmse_mean": 0.271272212266922,
      "eval_objectnav_pose_rmse_dtheta": 0.05315162241458893,
      "eval_objectnav_pose_rmse_dx": 0.024620048701763153,
      "eval_objectnav_pose_rmse_dy": 0.01045265793800354,
      "eval_objectnav_pose_rmse_mean": 0.029408110305666924,
      "eval_objectnav_pose_rotation_flip": 0.015350617468357086,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28235143423080444,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 5600
    },
    {
      "epoch": 0.26017468871956884,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09451910108327866,
      "eval_pointnav_mae_dtheta": 0.010927395895123482,
      "eval_pointnav_mae_dx": 0.002487560734152794,
      "eval_pointnav_mae_dy": 0.00250201765447855,
      "eval_pointnav_pose_mae_dtheta": 0.07637764513492584,
      "eval_pointnav_pose_mae_dx": 0.0277841966599226,
      "eval_pointnav_pose_mae_dy": 0.02709895372390747,
      "eval_pointnav_pose_rmse_dtheta": 0.21624210476875305,
      "eval_pointnav_pose_rmse_dx": 0.08555837720632553,
      "eval_pointnav_pose_rmse_dy": 0.07637200504541397,
      "eval_pointnav_pose_rmse_mean": 0.12605750560760498,
      "eval_pointnav_rmse_dtheta": 0.02664254978299141,
      "eval_pointnav_rmse_dx": 0.007749684154987335,
      "eval_pointnav_rmse_dy": 0.006651356816291809,
      "eval_pointnav_rmse_mean": 0.013681197538971901,
      "eval_pointnav_rotation_flip": 0.0049983239732682705,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09451910108327866,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 5600
    },
    {
      "epoch": 0.26017468871956884,
      "eval_loss": 0.23127983758846918,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31696897745132446,
      "eval_objectnav_nopose_mae_dtheta": 0.04024868831038475,
      "eval_objectnav_nopose_mae_dx": 0.013668430969119072,
      "eval_objectnav_nopose_mae_dy": 0.005283845588564873,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3220879137516022,
      "eval_objectnav_nopose_pose_mae_dx": 0.11083611100912094,
      "eval_objectnav_nopose_pose_mae_dy": 0.05883312597870827,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5427964329719543,
      "eval_objectnav_nopose_pose_rmse_dx": 0.24204155802726746,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13993299007415771,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30825698375701904,
      "eval_objectnav_nopose_rmse_dtheta": 0.058003321290016174,
      "eval_objectnav_nopose_rmse_dx": 0.026623399928212166,
      "eval_objectnav_nopose_rmse_dy": 0.010911349207162857,
      "eval_objectnav_nopose_rmse_mean": 0.031846024096012115,
      "eval_objectnav_nopose_rotation_flip": 0.016245128586888313,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31696897745132446,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28235143423080444,
      "eval_objectnav_pose_mae_dtheta": 0.03560531511902809,
      "eval_objectnav_pose_mae_dx": 0.012010294012725353,
      "eval_objectnav_pose_mae_dy": 0.005014169495552778,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2689439356327057,
      "eval_objectnav_pose_pose_mae_dx": 0.09360195696353912,
      "eval_objectnav_pose_pose_mae_dy": 0.052682772278785706,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46967437863349915,
      "eval_objectnav_pose_pose_rmse_dx": 0.2170853167772293,
      "eval_objectnav_pose_pose_rmse_dy": 0.12705691158771515,
      "eval_objectnav_pose_pose_rmse_mean": 0.271272212266922,
      "eval_objectnav_pose_rmse_dtheta": 0.05315162241458893,
      "eval_objectnav_pose_rmse_dx": 0.024620048701763153,
      "eval_objectnav_pose_rmse_dy": 0.01045265793800354,
      "eval_objectnav_pose_rmse_mean": 0.029408110305666924,
      "eval_objectnav_pose_rotation_flip": 0.015350617468357086,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28235143423080444,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09451910108327866,
      "eval_pointnav_mae_dtheta": 0.010927395895123482,
      "eval_pointnav_mae_dx": 0.002487560734152794,
      "eval_pointnav_mae_dy": 0.00250201765447855,
      "eval_pointnav_pose_mae_dtheta": 0.07637764513492584,
      "eval_pointnav_pose_mae_dx": 0.0277841966599226,
      "eval_pointnav_pose_mae_dy": 0.02709895372390747,
      "eval_pointnav_pose_rmse_dtheta": 0.21624210476875305,
      "eval_pointnav_pose_rmse_dx": 0.08555837720632553,
      "eval_pointnav_pose_rmse_dy": 0.07637200504541397,
      "eval_pointnav_pose_rmse_mean": 0.12605750560760498,
      "eval_pointnav_rmse_dtheta": 0.02664254978299141,
      "eval_pointnav_rmse_dx": 0.007749684154987335,
      "eval_pointnav_rmse_dy": 0.006651356816291809,
      "eval_pointnav_rmse_mean": 0.013681197538971901,
      "eval_pointnav_rotation_flip": 0.0049983239732682705,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09451910108327866,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 5600
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.2602211484854116,
      "grad_norm": 0.5277019739151001,
      "learning_rate": 5.60672190490541e-06,
      "loss": 0.0742,
      "mae_dtheta": 0.039888255298137665,
      "mae_dx": 0.008744978345930576,
      "mae_dy": 0.0034719447139650583,
      "pose_mae_dtheta": 0.3570495843887329,
      "pose_mae_dx": 0.07446763664484024,
      "pose_mae_dy": 0.05072532221674919,
      "pose_rmse_dtheta": 0.5828850269317627,
      "pose_rmse_dx": 0.16957373917102814,
      "pose_rmse_dy": 0.09989993274211884,
      "pose_rmse_mean": 0.284119576215744,
      "rmse_dtheta": 0.05697459727525711,
      "rmse_dx": 0.019565943628549576,
      "rmse_dy": 0.007514906581491232,
      "rmse_mean": 0.028018485754728317,
      "rotation_flip": 0.016722407191991806,
      "sparse_tokens": 5939.0,
      "step": 5601,
      "turn_loss": 0.23204760253429413,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2602676082512544,
      "grad_norm": 0.5384266972541809,
      "learning_rate": 5.605409435156774e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.009306061081588268,
      "mae_dx": 0.002261933870613575,
      "mae_dy": 0.001741596614010632,
      "pose_mae_dtheta": 0.06347977370023727,
      "pose_mae_dx": 0.02313799224793911,
      "pose_mae_dy": 0.024279842153191566,
      "pose_rmse_dtheta": 0.1730552315711975,
      "pose_rmse_dx": 0.0635167583823204,
      "pose_rmse_dy": 0.06164972484111786,
      "pose_rmse_mean": 0.09940724074840546,
      "rmse_dtheta": 0.021664977073669434,
      "rmse_dx": 0.008041022345423698,
      "rmse_dy": 0.003980209119617939,
      "rmse_mean": 0.011228736490011215,
      "rotation_flip": 0.004181601107120514,
      "sparse_tokens": 32041.0,
      "step": 5602,
      "turn_loss": 0.06793566793203354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3917.0,
      "epoch": 0.26031406801709717,
      "grad_norm": 0.46551546454429626,
      "learning_rate": 5.604096923071531e-06,
      "loss": 0.1062,
      "mae_dtheta": 0.05304979160428047,
      "mae_dx": 0.011159596964716911,
      "mae_dy": 0.004193850327283144,
      "pose_mae_dtheta": 0.4372197687625885,
      "pose_mae_dx": 0.09254325926303864,
      "pose_mae_dy": 0.055939435958862305,
      "pose_rmse_dtheta": 0.7822884917259216,
      "pose_rmse_dx": 0.194225013256073,
      "pose_rmse_dy": 0.11009819060564041,
      "pose_rmse_mean": 0.3622039258480072,
      "rmse_dtheta": 0.07550255954265594,
      "rmse_dx": 0.02242038957774639,
      "rmse_dy": 0.007565710227936506,
      "rmse_mean": 0.03516288846731186,
      "rotation_flip": 0.015625,
      "sparse_tokens": 3228.0,
      "step": 5603,
      "turn_loss": 0.3387815058231354,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.26036052778294,
      "grad_norm": 0.40146681666374207,
      "learning_rate": 5.602784368741467e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.031703583896160126,
      "mae_dx": 0.011019778437912464,
      "mae_dy": 0.0047419010661542416,
      "pose_mae_dtheta": 0.2476702332496643,
      "pose_mae_dx": 0.09942225366830826,
      "pose_mae_dy": 0.05791915953159332,
      "pose_rmse_dtheta": 0.41075682640075684,
      "pose_rmse_dx": 0.2243979275226593,
      "pose_rmse_dy": 0.13039152324199677,
      "pose_rmse_mean": 0.25518208742141724,
      "rmse_dtheta": 0.04658439755439758,
      "rmse_dx": 0.02386234514415264,
      "rmse_dy": 0.00867085624486208,
      "rmse_mean": 0.026372535154223442,
      "rotation_flip": 0.015243902802467346,
      "sparse_tokens": 17121.0,
      "step": 5604,
      "turn_loss": 0.2462591975927353,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2604069875487828,
      "grad_norm": 0.5336325764656067,
      "learning_rate": 5.601471772258368e-06,
      "loss": 0.151,
      "mae_dtheta": 0.01136423647403717,
      "mae_dx": 0.0021358930971473455,
      "mae_dy": 0.002699608448892832,
      "pose_mae_dtheta": 0.082853764295578,
      "pose_mae_dx": 0.025902971625328064,
      "pose_mae_dy": 0.02982275001704693,
      "pose_rmse_dtheta": 0.20552173256874084,
      "pose_rmse_dx": 0.0650283545255661,
      "pose_rmse_dy": 0.07421810179948807,
      "pose_rmse_mean": 0.11492272466421127,
      "rmse_dtheta": 0.025562912225723267,
      "rmse_dx": 0.006385451648384333,
      "rmse_dy": 0.006621684413403273,
      "rmse_mean": 0.012856683693826199,
      "rotation_flip": 0.010140405967831612,
      "sparse_tokens": 32137.0,
      "step": 5605,
      "turn_loss": 0.1006462499499321,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.26045344731462555,
      "grad_norm": 0.6911215782165527,
      "learning_rate": 5.6001591337140234e-06,
      "loss": 0.1489,
      "mae_dtheta": 0.03390519693493843,
      "mae_dx": 0.01449658628553152,
      "mae_dy": 0.006042244378477335,
      "pose_mae_dtheta": 0.2893501818180084,
      "pose_mae_dx": 0.12130927294492722,
      "pose_mae_dy": 0.0679151862859726,
      "pose_rmse_dtheta": 0.4654827117919922,
      "pose_rmse_dx": 0.2364671379327774,
      "pose_rmse_dy": 0.15825754404067993,
      "pose_rmse_mean": 0.28673580288887024,
      "rmse_dtheta": 0.04928319901227951,
      "rmse_dx": 0.026349617168307304,
      "rmse_dy": 0.010547883808612823,
      "rmse_mean": 0.02872690185904503,
      "rotation_flip": 0.01861993409693241,
      "sparse_tokens": 15975.0,
      "step": 5606,
      "turn_loss": 0.31386229395866394,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.26049990708046833,
      "grad_norm": 1.033565640449524,
      "learning_rate": 5.5988464532002305e-06,
      "loss": 0.2844,
      "mae_dtheta": 0.033733267337083817,
      "mae_dx": 0.011360188946127892,
      "mae_dy": 0.007132450584322214,
      "pose_mae_dtheta": 0.28259605169296265,
      "pose_mae_dx": 0.08965747803449631,
      "pose_mae_dy": 0.09435932338237762,
      "pose_rmse_dtheta": 0.5044757723808289,
      "pose_rmse_dx": 0.20337368547916412,
      "pose_rmse_dy": 0.21782571077346802,
      "pose_rmse_mean": 0.3085584044456482,
      "rmse_dtheta": 0.052044425159692764,
      "rmse_dx": 0.023640554398298264,
      "rmse_dy": 0.013505129143595695,
      "rmse_mean": 0.029730036854743958,
      "rotation_flip": 0.017746228724718094,
      "sparse_tokens": 21174.0,
      "step": 5607,
      "turn_loss": 0.27905508875846863,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.2605463668463111,
      "grad_norm": 0.5199970006942749,
      "learning_rate": 5.597533730808783e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.02888827584683895,
      "mae_dx": 0.005349319893866777,
      "mae_dy": 0.0031238349620252848,
      "pose_mae_dtheta": 0.22497332096099854,
      "pose_mae_dx": 0.04923102632164955,
      "pose_mae_dy": 0.03391439840197563,
      "pose_rmse_dtheta": 0.393730491399765,
      "pose_rmse_dx": 0.11249572783708572,
      "pose_rmse_dy": 0.08788605034351349,
      "pose_rmse_mean": 0.19803743064403534,
      "rmse_dtheta": 0.04574982076883316,
      "rmse_dx": 0.012548240832984447,
      "rmse_dy": 0.00717089232057333,
      "rmse_mean": 0.021822985261678696,
      "rotation_flip": 0.017006803303956985,
      "sparse_tokens": 13476.0,
      "step": 5608,
      "turn_loss": 0.21847231686115265,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.2605928266121539,
      "grad_norm": 0.6234408617019653,
      "learning_rate": 5.596220966631482e-06,
      "loss": 0.1773,
      "mae_dtheta": 0.04170387610793114,
      "mae_dx": 0.01766957715153694,
      "mae_dy": 0.009354913607239723,
      "pose_mae_dtheta": 0.32282164692878723,
      "pose_mae_dx": 0.12383890897035599,
      "pose_mae_dy": 0.09893059730529785,
      "pose_rmse_dtheta": 0.5267411470413208,
      "pose_rmse_dx": 0.27608951926231384,
      "pose_rmse_dy": 0.24159342050552368,
      "pose_rmse_mean": 0.3481413722038269,
      "rmse_dtheta": 0.05806674808263779,
      "rmse_dx": 0.031726520508527756,
      "rmse_dy": 0.019335618242621422,
      "rmse_mean": 0.03637629747390747,
      "rotation_flip": 0.014312976971268654,
      "sparse_tokens": 17336.0,
      "step": 5609,
      "turn_loss": 0.43505382537841797,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.26063928637799666,
      "grad_norm": 0.5647985339164734,
      "learning_rate": 5.594908160760128e-06,
      "loss": 0.103,
      "mae_dtheta": 0.010428023524582386,
      "mae_dx": 0.0016852507833391428,
      "mae_dy": 0.002374053467065096,
      "pose_mae_dtheta": 0.06900875270366669,
      "pose_mae_dx": 0.020270269364118576,
      "pose_mae_dy": 0.022219611331820488,
      "pose_rmse_dtheta": 0.20412631332874298,
      "pose_rmse_dx": 0.05071961507201195,
      "pose_rmse_dy": 0.052040427923202515,
      "pose_rmse_mean": 0.10229545086622238,
      "rmse_dtheta": 0.024722103029489517,
      "rmse_dx": 0.005717762280255556,
      "rmse_dy": 0.005386322736740112,
      "rmse_mean": 0.0119420625269413,
      "rotation_flip": 0.007039644289761782,
      "sparse_tokens": 32121.0,
      "step": 5610,
      "turn_loss": 0.07962071895599365,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.26068574614383944,
      "grad_norm": 0.37495502829551697,
      "learning_rate": 5.593595313286526e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.034001659601926804,
      "mae_dx": 0.009303824976086617,
      "mae_dy": 0.003972356673330069,
      "pose_mae_dtheta": 0.24775256216526031,
      "pose_mae_dx": 0.08388154953718185,
      "pose_mae_dy": 0.044450052082538605,
      "pose_rmse_dtheta": 0.4237413704395294,
      "pose_rmse_dx": 0.18797974288463593,
      "pose_rmse_dy": 0.1023586243391037,
      "pose_rmse_mean": 0.23802658915519714,
      "rmse_dtheta": 0.051759984344244,
      "rmse_dx": 0.019867630675435066,
      "rmse_dy": 0.007958091795444489,
      "rmse_mean": 0.02652857080101967,
      "rotation_flip": 0.01315789483487606,
      "sparse_tokens": 18045.0,
      "step": 5611,
      "turn_loss": 0.26654019951820374,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.2607322059096822,
      "grad_norm": 0.4343586266040802,
      "learning_rate": 5.592282424302486e-06,
      "loss": 0.0886,
      "mae_dtheta": 0.022340120747685432,
      "mae_dx": 0.008949406445026398,
      "mae_dy": 0.003476151032373309,
      "pose_mae_dtheta": 0.17036837339401245,
      "pose_mae_dx": 0.08236216753721237,
      "pose_mae_dy": 0.05970948189496994,
      "pose_rmse_dtheta": 0.31369510293006897,
      "pose_rmse_dx": 0.19426894187927246,
      "pose_rmse_dy": 0.13088561594486237,
      "pose_rmse_mean": 0.21294987201690674,
      "rmse_dtheta": 0.03719169646501541,
      "rmse_dx": 0.021228870376944542,
      "rmse_dy": 0.006176205351948738,
      "rmse_mean": 0.02153225801885128,
      "rotation_flip": 0.008009153418242931,
      "sparse_tokens": 20121.0,
      "step": 5612,
      "turn_loss": 0.17858563363552094,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.260778665675525,
      "grad_norm": 0.5762828588485718,
      "learning_rate": 5.59096949389982e-06,
      "loss": 0.074,
      "mae_dtheta": 0.028654228895902634,
      "mae_dx": 0.012558492831885815,
      "mae_dy": 0.0048030405305325985,
      "pose_mae_dtheta": 0.20763002336025238,
      "pose_mae_dx": 0.10163477808237076,
      "pose_mae_dy": 0.0615503266453743,
      "pose_rmse_dtheta": 0.3857877850532532,
      "pose_rmse_dx": 0.2139998823404312,
      "pose_rmse_dy": 0.12689803540706635,
      "pose_rmse_mean": 0.24222856760025024,
      "rmse_dtheta": 0.04509993642568588,
      "rmse_dx": 0.02496911585330963,
      "rmse_dy": 0.008426601998507977,
      "rmse_mean": 0.02616521716117859,
      "rotation_flip": 0.013119533658027649,
      "sparse_tokens": 12958.0,
      "step": 5613,
      "turn_loss": 0.2747073471546173,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.26082512544136777,
      "grad_norm": 0.48119768500328064,
      "learning_rate": 5.589656522170338e-06,
      "loss": 0.0721,
      "mae_dtheta": 0.008133331313729286,
      "mae_dx": 0.0013807741925120354,
      "mae_dy": 0.0015235914615914226,
      "pose_mae_dtheta": 0.06151166558265686,
      "pose_mae_dx": 0.012880433350801468,
      "pose_mae_dy": 0.01705602928996086,
      "pose_rmse_dtheta": 0.22479678690433502,
      "pose_rmse_dx": 0.035414326936006546,
      "pose_rmse_dy": 0.04324210062623024,
      "pose_rmse_mean": 0.10115107148885727,
      "rmse_dtheta": 0.024468082934617996,
      "rmse_dx": 0.004520080052316189,
      "rmse_dy": 0.003787945955991745,
      "rmse_mean": 0.010925370268523693,
      "rotation_flip": 0.0010362694738432765,
      "sparse_tokens": 32105.0,
      "step": 5614,
      "turn_loss": 0.05484387278556824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.26087158520721054,
      "grad_norm": 0.5932353138923645,
      "learning_rate": 5.588343509205859e-06,
      "loss": 0.1572,
      "mae_dtheta": 0.03446546941995621,
      "mae_dx": 0.011376255191862583,
      "mae_dy": 0.00366400508210063,
      "pose_mae_dtheta": 0.30022579431533813,
      "pose_mae_dx": 0.08183635771274567,
      "pose_mae_dy": 0.03557423874735832,
      "pose_rmse_dtheta": 0.6215837001800537,
      "pose_rmse_dx": 0.22388644516468048,
      "pose_rmse_dy": 0.09748150408267975,
      "pose_rmse_mean": 0.3143172264099121,
      "rmse_dtheta": 0.059790875762701035,
      "rmse_dx": 0.024558044970035553,
      "rmse_dy": 0.008222031407058239,
      "rmse_mean": 0.030856981873512268,
      "rotation_flip": 0.004926108289510012,
      "sparse_tokens": 3228.0,
      "step": 5615,
      "turn_loss": 0.19353646039962769,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.2609180449730533,
      "grad_norm": 0.4304502606391907,
      "learning_rate": 5.587030455098203e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.03933972120285034,
      "mae_dx": 0.01367445569485426,
      "mae_dy": 0.015696818009018898,
      "pose_mae_dtheta": 0.2928682267665863,
      "pose_mae_dx": 0.15408453345298767,
      "pose_mae_dy": 0.15271048247814178,
      "pose_rmse_dtheta": 0.4096750020980835,
      "pose_rmse_dx": 0.2424897402524948,
      "pose_rmse_dy": 0.28255215287208557,
      "pose_rmse_mean": 0.3115723133087158,
      "rmse_dtheta": 0.052211347967386246,
      "rmse_dx": 0.023249471560120583,
      "rmse_dy": 0.027875881642103195,
      "rmse_mean": 0.034445568919181824,
      "rotation_flip": 0.009389671497046947,
      "sparse_tokens": 3766.0,
      "step": 5616,
      "turn_loss": 0.5294854044914246,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2609645047388961,
      "grad_norm": 0.5733636617660522,
      "learning_rate": 5.585717359939192e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.012440115213394165,
      "mae_dx": 0.0020363552030175924,
      "mae_dy": 0.002272892277687788,
      "pose_mae_dtheta": 0.08352360129356384,
      "pose_mae_dx": 0.021615412086248398,
      "pose_mae_dy": 0.024484990164637566,
      "pose_rmse_dtheta": 0.22548533976078033,
      "pose_rmse_dx": 0.06072007492184639,
      "pose_rmse_dy": 0.05546197295188904,
      "pose_rmse_mean": 0.11388912796974182,
      "rmse_dtheta": 0.027370234951376915,
      "rmse_dx": 0.006489927880465984,
      "rmse_dy": 0.005705957766622305,
      "rmse_mean": 0.013188706710934639,
      "rotation_flip": 0.005009633954614401,
      "sparse_tokens": 32105.0,
      "step": 5617,
      "turn_loss": 0.09725842624902725,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.2610109645047389,
      "grad_norm": 0.6067144274711609,
      "learning_rate": 5.584404223820652e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.03454624488949776,
      "mae_dx": 0.005113789811730385,
      "mae_dy": 0.004206117708235979,
      "pose_mae_dtheta": 0.29865142703056335,
      "pose_mae_dx": 0.05003964528441429,
      "pose_mae_dy": 0.06864876300096512,
      "pose_rmse_dtheta": 0.5464391112327576,
      "pose_rmse_dx": 0.12059381604194641,
      "pose_rmse_dy": 0.1460946947336197,
      "pose_rmse_mean": 0.2710425555706024,
      "rmse_dtheta": 0.054225947707891464,
      "rmse_dx": 0.014794694259762764,
      "rmse_dy": 0.007571720518171787,
      "rmse_mean": 0.02553078904747963,
      "rotation_flip": 0.0178217813372612,
      "sparse_tokens": 9014.0,
      "step": 5618,
      "turn_loss": 0.2132588028907776,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.26105742427058165,
      "grad_norm": 0.5693997740745544,
      "learning_rate": 5.58309104683441e-06,
      "loss": 0.0957,
      "mae_dtheta": 0.009586011059582233,
      "mae_dx": 0.0014669367810711265,
      "mae_dy": 0.0013185787247493863,
      "pose_mae_dtheta": 0.06967215985059738,
      "pose_mae_dx": 0.012252183631062508,
      "pose_mae_dy": 0.01625378243625164,
      "pose_rmse_dtheta": 0.22933220863342285,
      "pose_rmse_dx": 0.03525596112012863,
      "pose_rmse_dy": 0.0475577637553215,
      "pose_rmse_mean": 0.10404865443706512,
      "rmse_dtheta": 0.027097344398498535,
      "rmse_dx": 0.005083730909973383,
      "rmse_dy": 0.00408385181799531,
      "rmse_mean": 0.012088309973478317,
      "rotation_flip": 0.004614674486219883,
      "sparse_tokens": 32169.0,
      "step": 5619,
      "turn_loss": 0.061583470553159714,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2611038840364245,
      "grad_norm": 0.6915180087089539,
      "learning_rate": 5.581777829072299e-06,
      "loss": 0.1717,
      "mae_dtheta": 0.010991618037223816,
      "mae_dx": 0.0035777606535702944,
      "mae_dy": 0.0016802978934720159,
      "pose_mae_dtheta": 0.07719562947750092,
      "pose_mae_dx": 0.03294947370886803,
      "pose_mae_dy": 0.022810444235801697,
      "pose_rmse_dtheta": 0.23141349852085114,
      "pose_rmse_dx": 0.09903951734304428,
      "pose_rmse_dy": 0.05858563259243965,
      "pose_rmse_mean": 0.12967956066131592,
      "rmse_dtheta": 0.027272865176200867,
      "rmse_dx": 0.011099870316684246,
      "rmse_dy": 0.003845596220344305,
      "rmse_mean": 0.014072777703404427,
      "rotation_flip": 0.0027919963467866182,
      "sparse_tokens": 32121.0,
      "step": 5620,
      "turn_loss": 0.11230351030826569,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.26115034380226726,
      "grad_norm": 0.8505257964134216,
      "learning_rate": 5.5804645706261515e-06,
      "loss": 0.1919,
      "mae_dtheta": 0.03778621554374695,
      "mae_dx": 0.014279463328421116,
      "mae_dy": 0.0029722717590630054,
      "pose_mae_dtheta": 0.2449951022863388,
      "pose_mae_dx": 0.10085229575634003,
      "pose_mae_dy": 0.049817197024822235,
      "pose_rmse_dtheta": 0.49163174629211426,
      "pose_rmse_dx": 0.2219691425561905,
      "pose_rmse_dy": 0.11296138912439346,
      "pose_rmse_mean": 0.27552077174186707,
      "rmse_dtheta": 0.05652263015508652,
      "rmse_dx": 0.02832050248980522,
      "rmse_dy": 0.00575657095760107,
      "rmse_mean": 0.030199900269508362,
      "rotation_flip": 0.01005025114864111,
      "sparse_tokens": 3141.0,
      "step": 5621,
      "turn_loss": 0.16810892522335052,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.26119680356811004,
      "grad_norm": 0.7194396257400513,
      "learning_rate": 5.579151271587806e-06,
      "loss": 0.1599,
      "mae_dtheta": 0.010131550952792168,
      "mae_dx": 0.001715407008305192,
      "mae_dy": 0.0027250235434621572,
      "pose_mae_dtheta": 0.06668365746736526,
      "pose_mae_dx": 0.027742359787225723,
      "pose_mae_dy": 0.030269892886281013,
      "pose_rmse_dtheta": 0.13525636494159698,
      "pose_rmse_dx": 0.06579381972551346,
      "pose_rmse_dy": 0.070208340883255,
      "pose_rmse_mean": 0.09041951596736908,
      "rmse_dtheta": 0.01893976330757141,
      "rmse_dx": 0.004514620173722506,
      "rmse_dy": 0.005581773817539215,
      "rmse_mean": 0.009678719565272331,
      "rotation_flip": 0.003754266304895282,
      "sparse_tokens": 32105.0,
      "step": 5622,
      "turn_loss": 0.08225315809249878,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2612432633339528,
      "grad_norm": 0.43822720646858215,
      "learning_rate": 5.5778379320491e-06,
      "loss": 0.0754,
      "mae_dtheta": 0.009960238821804523,
      "mae_dx": 0.0015158330788835883,
      "mae_dy": 0.0021000392735004425,
      "pose_mae_dtheta": 0.06966753304004669,
      "pose_mae_dx": 0.02197783812880516,
      "pose_mae_dy": 0.025585751980543137,
      "pose_rmse_dtheta": 0.1906370222568512,
      "pose_rmse_dx": 0.057154227048158646,
      "pose_rmse_dy": 0.058272067457437515,
      "pose_rmse_mean": 0.10202111303806305,
      "rmse_dtheta": 0.022245747968554497,
      "rmse_dx": 0.00536850793287158,
      "rmse_dy": 0.004437436815351248,
      "rmse_mean": 0.010683897882699966,
      "rotation_flip": 0.005319148767739534,
      "sparse_tokens": 32057.0,
      "step": 5623,
      "turn_loss": 0.08017406612634659,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2612897230997956,
      "grad_norm": 0.5953657627105713,
      "learning_rate": 5.576524552101879e-06,
      "loss": 0.1177,
      "mae_dtheta": 0.007261959835886955,
      "mae_dx": 0.001307978294789791,
      "mae_dy": 0.0015166567172855139,
      "pose_mae_dtheta": 0.05163760855793953,
      "pose_mae_dx": 0.016356106847524643,
      "pose_mae_dy": 0.02147042751312256,
      "pose_rmse_dtheta": 0.16215096414089203,
      "pose_rmse_dx": 0.05324805900454521,
      "pose_rmse_dy": 0.06607573479413986,
      "pose_rmse_mean": 0.09382492303848267,
      "rmse_dtheta": 0.018744193017482758,
      "rmse_dx": 0.004210954532027245,
      "rmse_dy": 0.003811305621638894,
      "rmse_mean": 0.008922151289880276,
      "rotation_flip": 0.003950617276132107,
      "sparse_tokens": 32073.0,
      "step": 5624,
      "turn_loss": 0.06560555100440979,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.26133618286563837,
      "grad_norm": 0.5596330761909485,
      "learning_rate": 5.575211131837984e-06,
      "loss": 0.1797,
      "mae_dtheta": 0.009028523229062557,
      "mae_dx": 0.0013745222240686417,
      "mae_dy": 0.001733491662889719,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5596330761909485,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 149.8096923828125,
      "model/head/act_norm_mean": 115.67715238320707,
      "model/head/act_norm_min": 65.4513931274414,
      "model/head/act_over_embed": 79.49442210430324,
      "model/head/grad_frac": 0.11754141747951508,
      "model/head/grad_norm": 0.06578006595373154,
      "model/head/grad_zero_frac": 0.00018592126434668899,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7092013888888888,
      "model/head/update_ratio": 0.001124839996919036,
      "model/head/weight_delta": 8.71036434173584,
      "model/head/weight_delta_rel": 0.15280559659004211,
      "model/head/weight_norm": 58.479488372802734,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4208320379257202,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4207645539314516,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.420675665140152,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2891533407215115,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06232642009854317,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03487992659211159,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5381264400921659,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011276912409812212,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8415660858154297,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09284281730651855,
      "model/modality_embedder.encoders.pose/weight_norm": 30.93038558959961,
      "model/modality_embedder/grad_frac": 0.06232642009854317,
      "model/modality_embedder/grad_norm": 0.03487992659211159,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5381264400921659,
      "model/modality_embedder/update_ratio": 0.0011276912409812212,
      "model/modality_embedder/weight_delta": 2.8415660858154297,
      "model/modality_embedder/weight_delta_rel": 0.09284281730651855,
      "model/modality_embedder/weight_norm": 30.93038558959961,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.10089111328125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.081351711560046,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.001032829284668,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.54893034935086,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09816695004701614,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05493747070431709,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001973201520740986,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.1920292377471924,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.07987886667251587,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.841794967651367,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.80868530273438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.086632696007698,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.250394821166992,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.239768853452144,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09889623522758484,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05534560605883598,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018714175093919039,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.7772626876831055,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09620655328035355,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.57416343688965,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.55496215820312,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.904123075998076,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.218568801879883,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.488765258194555,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10429240018129349,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05836547538638115,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019115270115435123,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 2.9931282997131348,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10050364583730698,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.533430099487305,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.27416229248047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.666751843835176,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.11789608001709,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.70006024944273,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11923947930335999,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06673035770654678,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022393090184777975,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.5551557540893555,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08732309937477112,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.799531936645508,
      "model/normalizer/grad_frac": 0.4932330548763275,
      "model/normalizer/grad_norm": 0.2760295271873474,
      "model/normalizer/grad_zero_frac": 0.0002328024711459875,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0035190805792808533,
      "model/normalizer/weight_delta": 5.415584564208984,
      "model/normalizer/weight_delta_rel": 0.06974959373474121,
      "model/normalizer/weight_norm": 78.4379653930664,
      "pose_mae_dtheta": 0.06117512658238411,
      "pose_mae_dx": 0.0188868660479784,
      "pose_mae_dy": 0.027190063148736954,
      "pose_rmse_dtheta": 0.11475864797830582,
      "pose_rmse_dx": 0.04840747267007828,
      "pose_rmse_dy": 0.05902693420648575,
      "pose_rmse_mean": 0.07406435906887054,
      "rmse_dtheta": 0.018219538033008575,
      "rmse_dx": 0.004826631397008896,
      "rmse_dy": 0.003596917260438204,
      "rmse_mean": 0.00888102874159813,
      "rotation_flip": 0.0017323517240583897,
      "sparse_tokens": 32057.0,
      "step": 5625,
      "turn_loss": 0.06741423904895782,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.26138264263148114,
      "grad_norm": 0.628166913986206,
      "learning_rate": 5.573897671349269e-06,
      "loss": 0.1512,
      "mae_dtheta": 0.025385383516550064,
      "mae_dx": 0.008745495229959488,
      "mae_dy": 0.0036521609872579575,
      "pose_mae_dtheta": 0.17417189478874207,
      "pose_mae_dx": 0.072014220058918,
      "pose_mae_dy": 0.04244763404130936,
      "pose_rmse_dtheta": 0.3731948435306549,
      "pose_rmse_dx": 0.19384105503559113,
      "pose_rmse_dy": 0.09404910355806351,
      "pose_rmse_mean": 0.22036167979240417,
      "rmse_dtheta": 0.043599262833595276,
      "rmse_dx": 0.020890722051262856,
      "rmse_dy": 0.00720891822129488,
      "rmse_mean": 0.023899635300040245,
      "rotation_flip": 0.012965964153409004,
      "sparse_tokens": 11424.0,
      "step": 5626,
      "turn_loss": 0.24947984516620636,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 25311.0,
      "epoch": 0.2614291023973239,
      "grad_norm": 0.3670591711997986,
      "learning_rate": 5.57258417072758e-06,
      "loss": 0.0983,
      "mae_dtheta": 0.02598005160689354,
      "mae_dx": 0.010378397069871426,
      "mae_dy": 0.0028065002989023924,
      "pose_mae_dtheta": 0.18305449187755585,
      "pose_mae_dx": 0.07770188897848129,
      "pose_mae_dy": 0.042885009199380875,
      "pose_rmse_dtheta": 0.33414071798324585,
      "pose_rmse_dx": 0.18858139216899872,
      "pose_rmse_dy": 0.11631064862012863,
      "pose_rmse_mean": 0.21301093697547913,
      "rmse_dtheta": 0.04356706142425537,
      "rmse_dx": 0.02303997054696083,
      "rmse_dy": 0.006078073754906654,
      "rmse_mean": 0.02422836795449257,
      "rotation_flip": 0.015342960134148598,
      "sparse_tokens": 20606.0,
      "step": 5627,
      "turn_loss": 0.22165533900260925,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.2614755621631667,
      "grad_norm": 0.5211949944496155,
      "learning_rate": 5.5712706300647725e-06,
      "loss": 0.1224,
      "mae_dtheta": 0.0324203222990036,
      "mae_dx": 0.012651372700929642,
      "mae_dy": 0.006143564358353615,
      "pose_mae_dtheta": 0.22865153849124908,
      "pose_mae_dx": 0.10213673114776611,
      "pose_mae_dy": 0.06633616238832474,
      "pose_rmse_dtheta": 0.38358333706855774,
      "pose_rmse_dx": 0.23320063948631287,
      "pose_rmse_dy": 0.14143100380897522,
      "pose_rmse_mean": 0.2527383267879486,
      "rmse_dtheta": 0.04746447503566742,
      "rmse_dx": 0.025937413796782494,
      "rmse_dy": 0.011870498768985271,
      "rmse_mean": 0.028424128890037537,
      "rotation_flip": 0.021937843412160873,
      "sparse_tokens": 18387.0,
      "step": 5628,
      "turn_loss": 0.3176117539405823,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 31145.0,
      "epoch": 0.2615220219290095,
      "grad_norm": 0.5299126505851746,
      "learning_rate": 5.569957049452703e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.028080353513360023,
      "mae_dx": 0.009202948771417141,
      "mae_dy": 0.002770590828731656,
      "pose_mae_dtheta": 0.2020469456911087,
      "pose_mae_dx": 0.06661339849233627,
      "pose_mae_dy": 0.031740233302116394,
      "pose_rmse_dtheta": 0.3874014914035797,
      "pose_rmse_dx": 0.16262789070606232,
      "pose_rmse_dy": 0.07330004870891571,
      "pose_rmse_mean": 0.2077764868736267,
      "rmse_dtheta": 0.046304136514663696,
      "rmse_dx": 0.020290283486247063,
      "rmse_dy": 0.005517819430679083,
      "rmse_mean": 0.02403741329908371,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 23890.0,
      "step": 5629,
      "turn_loss": 0.21396206319332123,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.26156848169485225,
      "grad_norm": 0.4309530258178711,
      "learning_rate": 5.568643428983232e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.010038881562650204,
      "mae_dx": 0.0020733221899718046,
      "mae_dy": 0.00273531605489552,
      "pose_mae_dtheta": 0.061546679586172104,
      "pose_mae_dx": 0.028808964416384697,
      "pose_mae_dy": 0.03142490237951279,
      "pose_rmse_dtheta": 0.12340111285448074,
      "pose_rmse_dx": 0.07468767464160919,
      "pose_rmse_dy": 0.07034279406070709,
      "pose_rmse_mean": 0.08947720378637314,
      "rmse_dtheta": 0.01958068087697029,
      "rmse_dx": 0.006131996866315603,
      "rmse_dy": 0.0060671172104775906,
      "rmse_mean": 0.010593265295028687,
      "rotation_flip": 0.006082289852201939,
      "sparse_tokens": 32105.0,
      "step": 5630,
      "turn_loss": 0.0892617478966713,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.261614941460695,
      "grad_norm": 0.5195028185844421,
      "learning_rate": 5.567329768748221e-06,
      "loss": 0.1032,
      "mae_dtheta": 0.0325569324195385,
      "mae_dx": 0.010235893540084362,
      "mae_dy": 0.006280712317675352,
      "pose_mae_dtheta": 0.2566617727279663,
      "pose_mae_dx": 0.07793239504098892,
      "pose_mae_dy": 0.07449749112129211,
      "pose_rmse_dtheta": 0.44696158170700073,
      "pose_rmse_dx": 0.17622022330760956,
      "pose_rmse_dy": 0.1750408560037613,
      "pose_rmse_mean": 0.2660742402076721,
      "rmse_dtheta": 0.04996585473418236,
      "rmse_dx": 0.022079555317759514,
      "rmse_dy": 0.012950504198670387,
      "rmse_mean": 0.028331970795989037,
      "rotation_flip": 0.01895734667778015,
      "sparse_tokens": 14438.0,
      "step": 5631,
      "turn_loss": 0.26558607816696167,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2616614012265378,
      "grad_norm": 0.4246440827846527,
      "learning_rate": 5.566016068839535e-06,
      "loss": 0.1225,
      "mae_dtheta": 0.012970431707799435,
      "mae_dx": 0.0016214950010180473,
      "mae_dy": 0.0023417300544679165,
      "pose_mae_dtheta": 0.0855889618396759,
      "pose_mae_dx": 0.021548349410295486,
      "pose_mae_dy": 0.028384288772940636,
      "pose_rmse_dtheta": 0.23594146966934204,
      "pose_rmse_dx": 0.056922297924757004,
      "pose_rmse_dy": 0.058536186814308167,
      "pose_rmse_mean": 0.11713331937789917,
      "rmse_dtheta": 0.028287015855312347,
      "rmse_dx": 0.005353173706680536,
      "rmse_dy": 0.0046468209475278854,
      "rmse_mean": 0.012762337923049927,
      "rotation_flip": 0.00873515009880066,
      "sparse_tokens": 32105.0,
      "step": 5632,
      "turn_loss": 0.0787433385848999,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.2617078609923806,
      "grad_norm": 0.4067338705062866,
      "learning_rate": 5.564702329349041e-06,
      "loss": 0.0837,
      "mae_dtheta": 0.015940966084599495,
      "mae_dx": 0.0023666059132665396,
      "mae_dy": 0.0015633006114512682,
      "pose_mae_dtheta": 0.1091645136475563,
      "pose_mae_dx": 0.016848403960466385,
      "pose_mae_dy": 0.016927961260080338,
      "pose_rmse_dtheta": 0.2990759611129761,
      "pose_rmse_dx": 0.040333881974220276,
      "pose_rmse_dy": 0.04327322915196419,
      "pose_rmse_mean": 0.1275610327720642,
      "rmse_dtheta": 0.037002645432949066,
      "rmse_dx": 0.006885637063533068,
      "rmse_dy": 0.0032034777104854584,
      "rmse_mean": 0.015697253867983818,
      "rotation_flip": 0.009302325546741486,
      "sparse_tokens": 7122.0,
      "step": 5633,
      "turn_loss": 0.10335392504930496,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.26175432075822336,
      "grad_norm": 0.4684223234653473,
      "learning_rate": 5.563388550368609e-06,
      "loss": 0.0784,
      "mae_dtheta": 0.008245410397648811,
      "mae_dx": 0.0015220382483676076,
      "mae_dy": 0.0009726673015393317,
      "pose_mae_dtheta": 0.0641782283782959,
      "pose_mae_dx": 0.01468706876039505,
      "pose_mae_dy": 0.015537438914179802,
      "pose_rmse_dtheta": 0.22733883559703827,
      "pose_rmse_dx": 0.03874681517481804,
      "pose_rmse_dy": 0.05285656079649925,
      "pose_rmse_mean": 0.10631407797336578,
      "rmse_dtheta": 0.025276584550738335,
      "rmse_dx": 0.004687975626438856,
      "rmse_dy": 0.00266633415594697,
      "rmse_mean": 0.010876964777708054,
      "rotation_flip": 0.0021367522422224283,
      "sparse_tokens": 32089.0,
      "step": 5634,
      "turn_loss": 0.050550296902656555,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.26180078052406613,
      "grad_norm": 0.4893133342266083,
      "learning_rate": 5.562074731990115e-06,
      "loss": 0.1486,
      "mae_dtheta": 0.01036642026156187,
      "mae_dx": 0.0023871902376413345,
      "mae_dy": 0.0030831480398774147,
      "pose_mae_dtheta": 0.07502519339323044,
      "pose_mae_dx": 0.025966262444853783,
      "pose_mae_dy": 0.03251564875245094,
      "pose_rmse_dtheta": 0.1743871122598648,
      "pose_rmse_dx": 0.07459761947393417,
      "pose_rmse_dy": 0.08774349093437195,
      "pose_rmse_mean": 0.11224274337291718,
      "rmse_dtheta": 0.020893676206469536,
      "rmse_dx": 0.007931469939649105,
      "rmse_dy": 0.008723065257072449,
      "rmse_mean": 0.012516070157289505,
      "rotation_flip": 0.006139154080301523,
      "sparse_tokens": 32153.0,
      "step": 5635,
      "turn_loss": 0.0920824259519577,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35689.0,
      "epoch": 0.2618472402899089,
      "grad_norm": 0.42022570967674255,
      "learning_rate": 5.560760874305432e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.031938981264829636,
      "mae_dx": 0.010957689955830574,
      "mae_dy": 0.004644550383090973,
      "pose_mae_dtheta": 0.25043267011642456,
      "pose_mae_dx": 0.08942089229822159,
      "pose_mae_dy": 0.06028679758310318,
      "pose_rmse_dtheta": 0.46376684308052063,
      "pose_rmse_dx": 0.2088172733783722,
      "pose_rmse_dy": 0.13403519988059998,
      "pose_rmse_mean": 0.26887309551239014,
      "rmse_dtheta": 0.04998279735445976,
      "rmse_dx": 0.024041717872023582,
      "rmse_dy": 0.008910452015697956,
      "rmse_mean": 0.027644990012049675,
      "rotation_flip": 0.01127596478909254,
      "sparse_tokens": 28842.0,
      "step": 5636,
      "turn_loss": 0.22341296076774597,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 10731.0,
      "epoch": 0.26189370005575174,
      "grad_norm": 0.6961952447891235,
      "learning_rate": 5.55944697740644e-06,
      "loss": 0.2357,
      "mae_dtheta": 0.03268326073884964,
      "mae_dx": 0.01439854595810175,
      "mae_dy": 0.008837779983878136,
      "pose_mae_dtheta": 0.26018115878105164,
      "pose_mae_dx": 0.12226774543523788,
      "pose_mae_dy": 0.14390450716018677,
      "pose_rmse_dtheta": 0.4316403865814209,
      "pose_rmse_dx": 0.2501552402973175,
      "pose_rmse_dy": 0.26745766401290894,
      "pose_rmse_mean": 0.31641775369644165,
      "rmse_dtheta": 0.0481269508600235,
      "rmse_dx": 0.02998117171227932,
      "rmse_dy": 0.01670646108686924,
      "rmse_mean": 0.031604863703250885,
      "rotation_flip": 0.008385743945837021,
      "sparse_tokens": 8624.0,
      "step": 5637,
      "turn_loss": 0.2968568503856659,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2619401598215945,
      "grad_norm": 0.46503546833992004,
      "learning_rate": 5.558133041385021e-06,
      "loss": 0.1239,
      "mae_dtheta": 0.010215646587312222,
      "mae_dx": 0.001965874107554555,
      "mae_dy": 0.0022432145196944475,
      "pose_mae_dtheta": 0.06782608479261398,
      "pose_mae_dx": 0.02423461154103279,
      "pose_mae_dy": 0.027726171538233757,
      "pose_rmse_dtheta": 0.1694636344909668,
      "pose_rmse_dx": 0.06720302253961563,
      "pose_rmse_dy": 0.07103032618761063,
      "pose_rmse_mean": 0.10256566107273102,
      "rmse_dtheta": 0.024278992787003517,
      "rmse_dx": 0.006166127510368824,
      "rmse_dy": 0.005227930378168821,
      "rmse_mean": 0.0118910176679492,
      "rotation_flip": 0.003771551651880145,
      "sparse_tokens": 32041.0,
      "step": 5638,
      "turn_loss": 0.1089470311999321,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2619866195874373,
      "grad_norm": 0.42143699526786804,
      "learning_rate": 5.556819066333059e-06,
      "loss": 0.0772,
      "mae_dtheta": 0.00895976833999157,
      "mae_dx": 0.0034596240147948265,
      "mae_dy": 0.0022621832322329283,
      "pose_mae_dtheta": 0.06927228718996048,
      "pose_mae_dx": 0.03185056522488594,
      "pose_mae_dy": 0.0249845702201128,
      "pose_rmse_dtheta": 0.20491503179073334,
      "pose_rmse_dx": 0.11060509830713272,
      "pose_rmse_dy": 0.0761319026350975,
      "pose_rmse_mean": 0.13055068254470825,
      "rmse_dtheta": 0.023254113271832466,
      "rmse_dx": 0.011420224793255329,
      "rmse_dy": 0.007250242400914431,
      "rmse_mean": 0.013974860310554504,
      "rotation_flip": 0.0049964310601353645,
      "sparse_tokens": 32057.0,
      "step": 5639,
      "turn_loss": 0.09100368618965149,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.2620330793532801,
      "grad_norm": 0.533668577671051,
      "learning_rate": 5.555505052342441e-06,
      "loss": 0.1183,
      "mae_dtheta": 0.027444161474704742,
      "mae_dx": 0.010965479537844658,
      "mae_dy": 0.003963233903050423,
      "pose_mae_dtheta": 0.22540636360645294,
      "pose_mae_dx": 0.08194135129451752,
      "pose_mae_dy": 0.049501482397317886,
      "pose_rmse_dtheta": 0.4974871873855591,
      "pose_rmse_dx": 0.17899757623672485,
      "pose_rmse_dy": 0.12403886765241623,
      "pose_rmse_mean": 0.26684123277664185,
      "rmse_dtheta": 0.049233827739953995,
      "rmse_dx": 0.023143645375967026,
      "rmse_dy": 0.007667326834052801,
      "rmse_mean": 0.026681600138545036,
      "rotation_flip": 0.01075268816202879,
      "sparse_tokens": 9422.0,
      "step": 5640,
      "turn_loss": 0.15875078737735748,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 18129.0,
      "epoch": 0.26207953911912285,
      "grad_norm": 0.5661851167678833,
      "learning_rate": 5.5541909995050554e-06,
      "loss": 0.15,
      "mae_dtheta": 0.032764311879873276,
      "mae_dx": 0.014577928930521011,
      "mae_dy": 0.004872961435467005,
      "pose_mae_dtheta": 0.24624070525169373,
      "pose_mae_dx": 0.11864589899778366,
      "pose_mae_dy": 0.0560247078537941,
      "pose_rmse_dtheta": 0.43219834566116333,
      "pose_rmse_dx": 0.2587798833847046,
      "pose_rmse_dy": 0.12562821805477142,
      "pose_rmse_mean": 0.27220216393470764,
      "rmse_dtheta": 0.04927246645092964,
      "rmse_dx": 0.027797380462288857,
      "rmse_dy": 0.01030674483627081,
      "rmse_mean": 0.029125532135367393,
      "rotation_flip": 0.013126491568982601,
      "sparse_tokens": 14813.0,
      "step": 5641,
      "turn_loss": 0.25635382533073425,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2621259988849656,
      "grad_norm": 0.35031548142433167,
      "learning_rate": 5.5528769079127974e-06,
      "loss": 0.0972,
      "mae_dtheta": 0.011474326252937317,
      "mae_dx": 0.002694896887987852,
      "mae_dy": 0.0032915386836975813,
      "pose_mae_dtheta": 0.07640917599201202,
      "pose_mae_dx": 0.028288012370467186,
      "pose_mae_dy": 0.033518921583890915,
      "pose_rmse_dtheta": 0.14496053755283356,
      "pose_rmse_dx": 0.07201571017503738,
      "pose_rmse_dy": 0.06950411945581436,
      "pose_rmse_mean": 0.09549345821142197,
      "rmse_dtheta": 0.021572696045041084,
      "rmse_dx": 0.008162388578057289,
      "rmse_dy": 0.00700422003865242,
      "rmse_mean": 0.012246435508131981,
      "rotation_flip": 0.004408522974699736,
      "sparse_tokens": 32089.0,
      "step": 5642,
      "turn_loss": 0.11496428400278091,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.2621724586508084,
      "grad_norm": 0.6655669808387756,
      "learning_rate": 5.55156277765756e-06,
      "loss": 0.1653,
      "mae_dtheta": 0.032755814492702484,
      "mae_dx": 0.012600439600646496,
      "mae_dy": 0.00557034881785512,
      "pose_mae_dtheta": 0.25017422437667847,
      "pose_mae_dx": 0.10064505785703659,
      "pose_mae_dy": 0.05638410896062851,
      "pose_rmse_dtheta": 0.47324350476264954,
      "pose_rmse_dx": 0.22590410709381104,
      "pose_rmse_dy": 0.13540372252464294,
      "pose_rmse_mean": 0.27818378806114197,
      "rmse_dtheta": 0.05424178019165993,
      "rmse_dx": 0.02543755993247032,
      "rmse_dy": 0.013988369144499302,
      "rmse_mean": 0.031222570687532425,
      "rotation_flip": 0.007518797181546688,
      "sparse_tokens": 20810.0,
      "step": 5643,
      "turn_loss": 0.3127599358558655,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2622189184166512,
      "grad_norm": 0.3776260018348694,
      "learning_rate": 5.55024860883124e-06,
      "loss": 0.0668,
      "mae_dtheta": 0.004912285599857569,
      "mae_dx": 0.001187724992632866,
      "mae_dy": 0.0005349831189960241,
      "pose_mae_dtheta": 0.03424449265003204,
      "pose_mae_dx": 0.01055394858121872,
      "pose_mae_dy": 0.009885849431157112,
      "pose_rmse_dtheta": 0.12878893315792084,
      "pose_rmse_dx": 0.030862797051668167,
      "pose_rmse_dy": 0.029480548575520515,
      "pose_rmse_mean": 0.06304409354925156,
      "rmse_dtheta": 0.01770537719130516,
      "rmse_dx": 0.004239977803081274,
      "rmse_dy": 0.001141909509897232,
      "rmse_mean": 0.007695754989981651,
      "rotation_flip": 0.002364066196605563,
      "sparse_tokens": 32105.0,
      "step": 5644,
      "turn_loss": 0.03889065608382225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.26226537818249396,
      "grad_norm": 0.6467636227607727,
      "learning_rate": 5.548934401525741e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.03584615886211395,
      "mae_dx": 0.009977519512176514,
      "mae_dy": 0.004962608218193054,
      "pose_mae_dtheta": 0.2595096528530121,
      "pose_mae_dx": 0.07688780874013901,
      "pose_mae_dy": 0.04667588323354721,
      "pose_rmse_dtheta": 0.46437397599220276,
      "pose_rmse_dx": 0.1789247989654541,
      "pose_rmse_dy": 0.11470501869916916,
      "pose_rmse_mean": 0.25266793370246887,
      "rmse_dtheta": 0.05537872016429901,
      "rmse_dx": 0.02178094908595085,
      "rmse_dy": 0.010997564531862736,
      "rmse_mean": 0.029385745525360107,
      "rotation_flip": 0.014474512077867985,
      "sparse_tokens": 25078.0,
      "step": 5645,
      "turn_loss": 0.28610652685165405,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 1658.0,
      "epoch": 0.26231183794833673,
      "grad_norm": 0.692525327205658,
      "learning_rate": 5.547620155832964e-06,
      "loss": 0.2014,
      "mae_dtheta": 0.04925161972641945,
      "mae_dx": 0.01729293167591095,
      "mae_dy": 0.013252257369458675,
      "pose_mae_dtheta": 0.33172401785850525,
      "pose_mae_dx": 0.23235726356506348,
      "pose_mae_dy": 0.16977515816688538,
      "pose_rmse_dtheta": 0.43770018219947815,
      "pose_rmse_dx": 0.3804207444190979,
      "pose_rmse_dy": 0.2207946628332138,
      "pose_rmse_mean": 0.3463052213191986,
      "rmse_dtheta": 0.06479755789041519,
      "rmse_dx": 0.03297972306609154,
      "rmse_dy": 0.01547932717949152,
      "rmse_mean": 0.03775220364332199,
      "rotation_flip": 0.0235294122248888,
      "sparse_tokens": 1498.0,
      "step": 5646,
      "turn_loss": 0.532815158367157,
      "turns": 5.0,
      "turns_per_sample": 5.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2623582977141795,
      "grad_norm": 0.6068058013916016,
      "learning_rate": 5.546305871844816e-06,
      "loss": 0.1011,
      "mae_dtheta": 0.010128402151167393,
      "mae_dx": 0.0017284718342125416,
      "mae_dy": 0.001765093649737537,
      "pose_mae_dtheta": 0.07223929464817047,
      "pose_mae_dx": 0.01648981124162674,
      "pose_mae_dy": 0.02035760134458542,
      "pose_rmse_dtheta": 0.20488497614860535,
      "pose_rmse_dx": 0.03926645591855049,
      "pose_rmse_dy": 0.047462768852710724,
      "pose_rmse_mean": 0.09720473736524582,
      "rmse_dtheta": 0.024339692667126656,
      "rmse_dx": 0.005405601114034653,
      "rmse_dy": 0.004147193860262632,
      "rmse_mean": 0.011297496035695076,
      "rotation_flip": 0.003475239034742117,
      "sparse_tokens": 32137.0,
      "step": 5647,
      "turn_loss": 0.07517935335636139,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.2624047574800223,
      "grad_norm": 0.5036888718605042,
      "learning_rate": 5.5449915496532056e-06,
      "loss": 0.1092,
      "mae_dtheta": 0.010335052385926247,
      "mae_dx": 0.001466832123696804,
      "mae_dy": 0.00220827991142869,
      "pose_mae_dtheta": 0.06450112909078598,
      "pose_mae_dx": 0.017389558255672455,
      "pose_mae_dy": 0.028561528772115707,
      "pose_rmse_dtheta": 0.16902972757816315,
      "pose_rmse_dx": 0.052465420216321945,
      "pose_rmse_dy": 0.05863650515675545,
      "pose_rmse_mean": 0.09337722510099411,
      "rmse_dtheta": 0.02197771891951561,
      "rmse_dx": 0.006011578720062971,
      "rmse_dy": 0.004260089248418808,
      "rmse_mean": 0.010749796405434608,
      "rotation_flip": 0.007741935551166534,
      "sparse_tokens": 32025.0,
      "step": 5648,
      "turn_loss": 0.07176666706800461,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.26245121724586506,
      "grad_norm": 0.5393281579017639,
      "learning_rate": 5.543677189350043e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.010466509498655796,
      "mae_dx": 0.0020787620451301336,
      "mae_dy": 0.0029967259615659714,
      "pose_mae_dtheta": 0.06992650777101517,
      "pose_mae_dx": 0.024872364476323128,
      "pose_mae_dy": 0.02866094559431076,
      "pose_rmse_dtheta": 0.14918945729732513,
      "pose_rmse_dx": 0.06398487836122513,
      "pose_rmse_dy": 0.06619225442409515,
      "pose_rmse_mean": 0.0931222066283226,
      "rmse_dtheta": 0.021347180008888245,
      "rmse_dx": 0.007366586476564407,
      "rmse_dy": 0.007231761701405048,
      "rmse_mean": 0.011981843039393425,
      "rotation_flip": 0.0039956411346793175,
      "sparse_tokens": 32105.0,
      "step": 5649,
      "turn_loss": 0.10228623449802399,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.26249767701170784,
      "grad_norm": 0.384769082069397,
      "learning_rate": 5.542362791027243e-06,
      "loss": 0.0977,
      "mae_dtheta": 0.008377259597182274,
      "mae_dx": 0.0016495826421305537,
      "mae_dy": 0.002106207888573408,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.384769082069397,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.32254028320312,
      "model/head/act_norm_mean": 113.13947088068181,
      "model/head/act_norm_min": 73.49564361572266,
      "model/head/act_over_embed": 77.75050361761934,
      "model/head/grad_frac": 0.09386146813631058,
      "model/head/grad_norm": 0.03611499071121216,
      "model/head/grad_zero_frac": 0.00020749573013745248,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7054578993055556,
      "model/head/update_ratio": 0.0006175285670906305,
      "model/head/weight_delta": 8.725335121154785,
      "model/head/weight_delta_rel": 0.15306822955608368,
      "model/head/weight_norm": 58.48310852050781,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42090922594070435,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42084465199466203,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42077893018722534,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2892083848604396,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11016976833343506,
      "model/modality_embedder.encoders.pose/grad_norm": 0.042389921844005585,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.505550056561086,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013704855227842927,
      "model/modality_embedder.encoders.pose/weight_delta": 2.844294786453247,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09293197840452194,
      "model/modality_embedder.encoders.pose/weight_norm": 30.930587768554688,
      "model/modality_embedder/grad_frac": 0.11016976833343506,
      "model/modality_embedder/grad_norm": 0.042389921844005585,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.505550056561086,
      "model/modality_embedder/update_ratio": 0.0013704855227842927,
      "model/modality_embedder/weight_delta": 2.844294786453247,
      "model/modality_embedder/weight_delta_rel": 0.09293197840452194,
      "model/modality_embedder/weight_norm": 30.930587768554688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.10846710205078,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.88454986371653,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.950698852539062,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.413686277024865,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06271659582853317,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.024131406098604202,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008666784851811826,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.1976797580718994,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08008477836847305,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.843549728393555,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.8994369506836,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.901627886002885,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.346360206604004,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.112631815974517,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06264552474021912,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.024104060605168343,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008149820496328175,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.7845890522003174,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09646034240722656,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.57618522644043,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.01051330566406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.804270382395384,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.428499221801758,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.420145552315137,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06103997305035591,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.023486293852329254,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007691423525102437,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.000967264175415,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1007668599486351,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.53569221496582,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.66561126708984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.58048240339907,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.180476188659668,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.640775082307808,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06367141008377075,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02449878863990307,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008220596355386078,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.5625123977661133,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08757451176643372,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.80171775817871,
      "model/normalizer/grad_frac": 0.24274016916751862,
      "model/normalizer/grad_norm": 0.09339891374111176,
      "model/normalizer/grad_zero_frac": 0.00023989289184100926,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001190696726553142,
      "model/normalizer/weight_delta": 5.4300408363342285,
      "model/normalizer/weight_delta_rel": 0.06993578374385834,
      "model/normalizer/weight_norm": 78.44055938720703,
      "pose_mae_dtheta": 0.056667570024728775,
      "pose_mae_dx": 0.0219942107796669,
      "pose_mae_dy": 0.027248097583651543,
      "pose_rmse_dtheta": 0.12461962550878525,
      "pose_rmse_dx": 0.060029949992895126,
      "pose_rmse_dy": 0.06687447428703308,
      "pose_rmse_mean": 0.08384134620428085,
      "rmse_dtheta": 0.017522616311907768,
      "rmse_dx": 0.0057032546028494835,
      "rmse_dy": 0.004365956410765648,
      "rmse_mean": 0.009197276085615158,
      "rotation_flip": 0.004904146306216717,
      "sparse_tokens": 32089.0,
      "step": 5650,
      "turn_loss": 0.07165602594614029,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.2625441367775506,
      "grad_norm": 0.5470995903015137,
      "learning_rate": 5.541048354776721e-06,
      "loss": 0.1005,
      "mae_dtheta": 0.03765074163675308,
      "mae_dx": 0.007494206074625254,
      "mae_dy": 0.004259440116584301,
      "pose_mae_dtheta": 0.314642995595932,
      "pose_mae_dx": 0.07593101263046265,
      "pose_mae_dy": 0.0609908401966095,
      "pose_rmse_dtheta": 0.5557491183280945,
      "pose_rmse_dx": 0.18109829723834991,
      "pose_rmse_dy": 0.1915845423936844,
      "pose_rmse_mean": 0.3094773292541504,
      "rmse_dtheta": 0.057063207030296326,
      "rmse_dx": 0.017240561544895172,
      "rmse_dy": 0.010764517821371555,
      "rmse_mean": 0.028356095775961876,
      "rotation_flip": 0.006833713036030531,
      "sparse_tokens": 8314.0,
      "step": 5651,
      "turn_loss": 0.27836158871650696,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.2625905965433934,
      "grad_norm": 0.851554811000824,
      "learning_rate": 5.5397338806903985e-06,
      "loss": 0.1498,
      "mae_dtheta": 0.0276495348662138,
      "mae_dx": 0.005396587774157524,
      "mae_dy": 0.002509885933250189,
      "pose_mae_dtheta": 0.22248993813991547,
      "pose_mae_dx": 0.05259203538298607,
      "pose_mae_dy": 0.030865371227264404,
      "pose_rmse_dtheta": 0.4467706084251404,
      "pose_rmse_dx": 0.1305740922689438,
      "pose_rmse_dy": 0.07707248628139496,
      "pose_rmse_mean": 0.21813908219337463,
      "rmse_dtheta": 0.04726701229810715,
      "rmse_dx": 0.013041072525084019,
      "rmse_dy": 0.004915345460176468,
      "rmse_mean": 0.021741142496466637,
      "rotation_flip": 0.006000000052154064,
      "sparse_tokens": 9623.0,
      "step": 5652,
      "turn_loss": 0.19433622062206268,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 32441.0,
      "epoch": 0.2626370563092362,
      "grad_norm": 0.5307080149650574,
      "learning_rate": 5.538419368860196e-06,
      "loss": 0.1325,
      "mae_dtheta": 0.03471735492348671,
      "mae_dx": 0.011337846517562866,
      "mae_dy": 0.00420148903504014,
      "pose_mae_dtheta": 0.2525935471057892,
      "pose_mae_dx": 0.09145859628915787,
      "pose_mae_dy": 0.051349442452192307,
      "pose_rmse_dtheta": 0.4454980492591858,
      "pose_rmse_dx": 0.21232058107852936,
      "pose_rmse_dy": 0.11863142997026443,
      "pose_rmse_mean": 0.2588166892528534,
      "rmse_dtheta": 0.05280470475554466,
      "rmse_dx": 0.023796025663614273,
      "rmse_dy": 0.008180776610970497,
      "rmse_mean": 0.028260502964258194,
      "rotation_flip": 0.014232673682272434,
      "sparse_tokens": 26413.0,
      "step": 5653,
      "turn_loss": 0.2685970067977905,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.262683516075079,
      "grad_norm": 0.49492719769477844,
      "learning_rate": 5.537104819378037e-06,
      "loss": 0.1036,
      "mae_dtheta": 0.00849002692848444,
      "mae_dx": 0.0016536442562937737,
      "mae_dy": 0.0021838750690221786,
      "pose_mae_dtheta": 0.05301553010940552,
      "pose_mae_dx": 0.018544534221291542,
      "pose_mae_dy": 0.02383396029472351,
      "pose_rmse_dtheta": 0.1111726462841034,
      "pose_rmse_dx": 0.049804553389549255,
      "pose_rmse_dy": 0.054619304835796356,
      "pose_rmse_mean": 0.0718654990196228,
      "rmse_dtheta": 0.017260977998375893,
      "rmse_dx": 0.004831134341657162,
      "rmse_dy": 0.005059408489614725,
      "rmse_mean": 0.009050507098436356,
      "rotation_flip": 0.009948269464075565,
      "sparse_tokens": 32121.0,
      "step": 5654,
      "turn_loss": 0.08054235577583313,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.2627299758409218,
      "grad_norm": 0.5122050642967224,
      "learning_rate": 5.53579023233585e-06,
      "loss": 0.0901,
      "mae_dtheta": 0.04846784844994545,
      "mae_dx": 0.014871588908135891,
      "mae_dy": 0.013256602920591831,
      "pose_mae_dtheta": 0.38581082224845886,
      "pose_mae_dx": 0.11728659272193909,
      "pose_mae_dy": 0.08637652546167374,
      "pose_rmse_dtheta": 0.5907754898071289,
      "pose_rmse_dx": 0.22488947212696075,
      "pose_rmse_dy": 0.1680624932050705,
      "pose_rmse_mean": 0.3279091715812683,
      "rmse_dtheta": 0.06896083056926727,
      "rmse_dx": 0.026566337794065475,
      "rmse_dy": 0.025072665885090828,
      "rmse_mean": 0.040199946612119675,
      "rotation_flip": 0.024561403319239616,
      "sparse_tokens": 4645.0,
      "step": 5655,
      "turn_loss": 0.49276649951934814,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.26277643560676456,
      "grad_norm": 0.712316632270813,
      "learning_rate": 5.534475607825566e-06,
      "loss": 0.1638,
      "mae_dtheta": 0.029252097010612488,
      "mae_dx": 0.01727617159485817,
      "mae_dy": 0.0064120483584702015,
      "pose_mae_dtheta": 0.2531376779079437,
      "pose_mae_dx": 0.14947286248207092,
      "pose_mae_dy": 0.0972590371966362,
      "pose_rmse_dtheta": 0.4547039866447449,
      "pose_rmse_dx": 0.28371989727020264,
      "pose_rmse_dy": 0.21093326807022095,
      "pose_rmse_mean": 0.31645238399505615,
      "rmse_dtheta": 0.04629132151603699,
      "rmse_dx": 0.03096667490899563,
      "rmse_dy": 0.010650628246366978,
      "rmse_mean": 0.029302876442670822,
      "rotation_flip": 0.008976660668849945,
      "sparse_tokens": 10650.0,
      "step": 5656,
      "turn_loss": 0.32184845209121704,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.26282289537260733,
      "grad_norm": 0.4343326687812805,
      "learning_rate": 5.533160945939113e-06,
      "loss": 0.0909,
      "mae_dtheta": 0.01253952831029892,
      "mae_dx": 0.0017722774064168334,
      "mae_dy": 0.0032756440341472626,
      "pose_mae_dtheta": 0.08529253304004669,
      "pose_mae_dx": 0.030011149123311043,
      "pose_mae_dy": 0.041597019881010056,
      "pose_rmse_dtheta": 0.16567614674568176,
      "pose_rmse_dx": 0.07372759282588959,
      "pose_rmse_dy": 0.09678243100643158,
      "pose_rmse_mean": 0.11206205934286118,
      "rmse_dtheta": 0.023307817056775093,
      "rmse_dx": 0.004713408648967743,
      "rmse_dy": 0.006467428058385849,
      "rmse_mean": 0.011496218852698803,
      "rotation_flip": 0.0058555626310408115,
      "sparse_tokens": 32105.0,
      "step": 5657,
      "turn_loss": 0.09550660848617554,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.2628693551384501,
      "grad_norm": 0.4341953992843628,
      "learning_rate": 5.531846246768431e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.033323321491479874,
      "mae_dx": 0.007152414880692959,
      "mae_dy": 0.004861839115619659,
      "pose_mae_dtheta": 0.2627424895763397,
      "pose_mae_dx": 0.06027279049158096,
      "pose_mae_dy": 0.07499781250953674,
      "pose_rmse_dtheta": 0.48943543434143066,
      "pose_rmse_dx": 0.12628448009490967,
      "pose_rmse_dy": 0.16347606480121613,
      "pose_rmse_mean": 0.2597320079803467,
      "rmse_dtheta": 0.05290224403142929,
      "rmse_dx": 0.016444584354758263,
      "rmse_dy": 0.009316935203969479,
      "rmse_mean": 0.02622125670313835,
      "rotation_flip": 0.008321775123476982,
      "sparse_tokens": 11828.0,
      "step": 5658,
      "turn_loss": 0.20922334492206573,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2629158149042929,
      "grad_norm": 0.3706797957420349,
      "learning_rate": 5.530531510405454e-06,
      "loss": 0.109,
      "mae_dtheta": 0.00782928615808487,
      "mae_dx": 0.0013649548636749387,
      "mae_dy": 0.0015168350655585527,
      "pose_mae_dtheta": 0.05715533718466759,
      "pose_mae_dx": 0.016093909740447998,
      "pose_mae_dy": 0.019307786598801613,
      "pose_rmse_dtheta": 0.17493779957294464,
      "pose_rmse_dx": 0.043783433735370636,
      "pose_rmse_dy": 0.04692815989255905,
      "pose_rmse_mean": 0.08854980766773224,
      "rmse_dtheta": 0.019757354632019997,
      "rmse_dx": 0.004697058349847794,
      "rmse_dy": 0.0033337620552629232,
      "rmse_mean": 0.009262725710868835,
      "rotation_flip": 0.0029083858244121075,
      "sparse_tokens": 32089.0,
      "step": 5659,
      "turn_loss": 0.06166813522577286,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.26296227467013567,
      "grad_norm": 0.5240210890769958,
      "learning_rate": 5.529216736942126e-06,
      "loss": 0.168,
      "mae_dtheta": 0.010526015423238277,
      "mae_dx": 0.002008836716413498,
      "mae_dy": 0.0034863015171140432,
      "pose_mae_dtheta": 0.06863526254892349,
      "pose_mae_dx": 0.027953369542956352,
      "pose_mae_dy": 0.031353991478681564,
      "pose_rmse_dtheta": 0.12764587998390198,
      "pose_rmse_dx": 0.06836438924074173,
      "pose_rmse_dy": 0.0656970739364624,
      "pose_rmse_mean": 0.08723577857017517,
      "rmse_dtheta": 0.0199239831417799,
      "rmse_dx": 0.005039190873503685,
      "rmse_dy": 0.007329159881919622,
      "rmse_mean": 0.010764110833406448,
      "rotation_flip": 0.003701211418956518,
      "sparse_tokens": 32105.0,
      "step": 5660,
      "turn_loss": 0.0977027416229248,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.26300873443597844,
      "grad_norm": 0.45541322231292725,
      "learning_rate": 5.527901926470386e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.01170777902007103,
      "mae_dx": 0.0014772822614759207,
      "mae_dy": 0.0027395926881581545,
      "pose_mae_dtheta": 0.07418075948953629,
      "pose_mae_dx": 0.023209596052765846,
      "pose_mae_dy": 0.032875798642635345,
      "pose_rmse_dtheta": 0.2044905126094818,
      "pose_rmse_dx": 0.055264633148908615,
      "pose_rmse_dy": 0.09839629381895065,
      "pose_rmse_mean": 0.1193838119506836,
      "rmse_dtheta": 0.024610349908471107,
      "rmse_dx": 0.00378953805193305,
      "rmse_dy": 0.005960711278021336,
      "rmse_mean": 0.011453533545136452,
      "rotation_flip": 0.008760545402765274,
      "sparse_tokens": 32121.0,
      "step": 5661,
      "turn_loss": 0.08516275137662888,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.2630551942018212,
      "grad_norm": 0.8197848200798035,
      "learning_rate": 5.526587079082181e-06,
      "loss": 0.2379,
      "mae_dtheta": 0.031278952956199646,
      "mae_dx": 0.010295789688825607,
      "mae_dy": 0.007820523343980312,
      "pose_mae_dtheta": 0.23308725655078888,
      "pose_mae_dx": 0.09487767517566681,
      "pose_mae_dy": 0.11020903289318085,
      "pose_rmse_dtheta": 0.38983437418937683,
      "pose_rmse_dx": 0.19831600785255432,
      "pose_rmse_dy": 0.23206263780593872,
      "pose_rmse_mean": 0.2734043598175049,
      "rmse_dtheta": 0.046860743314027786,
      "rmse_dx": 0.022318381816148758,
      "rmse_dy": 0.01483096182346344,
      "rmse_mean": 0.02800336293876171,
      "rotation_flip": 0.01957295462489128,
      "sparse_tokens": 21968.0,
      "step": 5662,
      "turn_loss": 0.2819189429283142,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.263101653967664,
      "grad_norm": 0.6142836809158325,
      "learning_rate": 5.525272194869457e-06,
      "loss": 0.1731,
      "mae_dtheta": 0.03054019808769226,
      "mae_dx": 0.007021878380328417,
      "mae_dy": 0.005410546902567148,
      "pose_mae_dtheta": 0.23954914510250092,
      "pose_mae_dx": 0.0636521726846695,
      "pose_mae_dy": 0.06933939456939697,
      "pose_rmse_dtheta": 0.4194148778915405,
      "pose_rmse_dx": 0.1415390968322754,
      "pose_rmse_dy": 0.15459796786308289,
      "pose_rmse_mean": 0.23851732909679413,
      "rmse_dtheta": 0.046445973217487335,
      "rmse_dx": 0.016415338963270187,
      "rmse_dy": 0.00981534831225872,
      "rmse_mean": 0.02422555349767208,
      "rotation_flip": 0.016708437353372574,
      "sparse_tokens": 18608.0,
      "step": 5663,
      "turn_loss": 0.28786665201187134,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.26314811373350677,
      "grad_norm": 0.5324447154998779,
      "learning_rate": 5.52395727392417e-06,
      "loss": 0.1061,
      "mae_dtheta": 0.034239768981933594,
      "mae_dx": 0.015629621222615242,
      "mae_dy": 0.00510191498324275,
      "pose_mae_dtheta": 0.2723803222179413,
      "pose_mae_dx": 0.10895434021949768,
      "pose_mae_dy": 0.06061025708913803,
      "pose_rmse_dtheta": 0.45936161279678345,
      "pose_rmse_dx": 0.22944606840610504,
      "pose_rmse_dy": 0.12801223993301392,
      "pose_rmse_mean": 0.27227330207824707,
      "rmse_dtheta": 0.05139352008700371,
      "rmse_dx": 0.028021175414323807,
      "rmse_dy": 0.009338149800896645,
      "rmse_mean": 0.029584281146526337,
      "rotation_flip": 0.011682243086397648,
      "sparse_tokens": 7737.0,
      "step": 5664,
      "turn_loss": 0.30274513363838196,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.26319457349934955,
      "grad_norm": 0.7377449870109558,
      "learning_rate": 5.522642316338268e-06,
      "loss": 0.1855,
      "mae_dtheta": 0.009452629834413528,
      "mae_dx": 0.0017240571323782206,
      "mae_dy": 0.0025494620203971863,
      "pose_mae_dtheta": 0.06741809099912643,
      "pose_mae_dx": 0.02484354004263878,
      "pose_mae_dy": 0.029789607971906662,
      "pose_rmse_dtheta": 0.14281605184078217,
      "pose_rmse_dx": 0.07262083888053894,
      "pose_rmse_dy": 0.07772921770811081,
      "pose_rmse_mean": 0.09772203862667084,
      "rmse_dtheta": 0.01974414475262165,
      "rmse_dx": 0.005379884969443083,
      "rmse_dy": 0.006494399160146713,
      "rmse_mean": 0.010539477691054344,
      "rotation_flip": 0.0055350554175674915,
      "sparse_tokens": 32057.0,
      "step": 5665,
      "turn_loss": 0.08914972841739655,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2632410332651923,
      "grad_norm": 0.5031630396842957,
      "learning_rate": 5.521327322203708e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.0114393699914217,
      "mae_dx": 0.0027220286428928375,
      "mae_dy": 0.002829471603035927,
      "pose_mae_dtheta": 0.07458782941102982,
      "pose_mae_dx": 0.027864037081599236,
      "pose_mae_dy": 0.022896939888596535,
      "pose_rmse_dtheta": 0.19057200849056244,
      "pose_rmse_dx": 0.06370376795530319,
      "pose_rmse_dy": 0.045962560921907425,
      "pose_rmse_mean": 0.10007944703102112,
      "rmse_dtheta": 0.024765510112047195,
      "rmse_dx": 0.007634416688233614,
      "rmse_dy": 0.006951514631509781,
      "rmse_mean": 0.013117147609591484,
      "rotation_flip": 0.0018532245885580778,
      "sparse_tokens": 32185.0,
      "step": 5666,
      "turn_loss": 0.0977354347705841,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.2632874930310351,
      "grad_norm": 0.6411385536193848,
      "learning_rate": 5.520012291612449e-06,
      "loss": 0.1902,
      "mae_dtheta": 0.03520935773849487,
      "mae_dx": 0.013639003969728947,
      "mae_dy": 0.008110045455396175,
      "pose_mae_dtheta": 0.24806994199752808,
      "pose_mae_dx": 0.0987725779414177,
      "pose_mae_dy": 0.07464486360549927,
      "pose_rmse_dtheta": 0.4331428110599518,
      "pose_rmse_dx": 0.20432747900485992,
      "pose_rmse_dy": 0.17609810829162598,
      "pose_rmse_mean": 0.27118948101997375,
      "rmse_dtheta": 0.0530320405960083,
      "rmse_dx": 0.02547532133758068,
      "rmse_dy": 0.01653497852385044,
      "rmse_mean": 0.03168078139424324,
      "rotation_flip": 0.015258216299116611,
      "sparse_tokens": 13591.0,
      "step": 5667,
      "turn_loss": 0.27821823954582214,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.2633339527968779,
      "grad_norm": 0.5487650036811829,
      "learning_rate": 5.518697224656452e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.035017337650060654,
      "mae_dx": 0.013026847504079342,
      "mae_dy": 0.006796046160161495,
      "pose_mae_dtheta": 0.27376869320869446,
      "pose_mae_dx": 0.11481072753667831,
      "pose_mae_dy": 0.08697997778654099,
      "pose_rmse_dtheta": 0.48747479915618896,
      "pose_rmse_dx": 0.2361401617527008,
      "pose_rmse_dy": 0.17273248732089996,
      "pose_rmse_mean": 0.29878246784210205,
      "rmse_dtheta": 0.051259949803352356,
      "rmse_dx": 0.025220025330781937,
      "rmse_dy": 0.011342431418597698,
      "rmse_mean": 0.02927413396537304,
      "rotation_flip": 0.015775635838508606,
      "sparse_tokens": 20588.0,
      "step": 5668,
      "turn_loss": 0.25704649090766907,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2633804125627207,
      "grad_norm": 0.3746267259120941,
      "learning_rate": 5.517382121427679e-06,
      "loss": 0.0741,
      "mae_dtheta": 0.012400820851325989,
      "mae_dx": 0.002669557463377714,
      "mae_dy": 0.004019265994429588,
      "pose_mae_dtheta": 0.08446845412254333,
      "pose_mae_dx": 0.03261696547269821,
      "pose_mae_dy": 0.03421789035201073,
      "pose_rmse_dtheta": 0.1977435201406479,
      "pose_rmse_dx": 0.07995302975177765,
      "pose_rmse_dy": 0.08082661032676697,
      "pose_rmse_mean": 0.11950772255659103,
      "rmse_dtheta": 0.025008216500282288,
      "rmse_dx": 0.00699737761169672,
      "rmse_dy": 0.009226924739778042,
      "rmse_mean": 0.0137441735714674,
      "rotation_flip": 0.007728494703769684,
      "sparse_tokens": 32169.0,
      "step": 5669,
      "turn_loss": 0.1161363497376442,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2634268723285635,
      "grad_norm": 0.7822638154029846,
      "learning_rate": 5.516066982018097e-06,
      "loss": 0.1958,
      "mae_dtheta": 0.015567122958600521,
      "mae_dx": 0.0028114814776927233,
      "mae_dy": 0.004204305820167065,
      "pose_mae_dtheta": 0.10722213983535767,
      "pose_mae_dx": 0.03765113279223442,
      "pose_mae_dy": 0.04572861269116402,
      "pose_rmse_dtheta": 0.2340577244758606,
      "pose_rmse_dx": 0.08628050982952118,
      "pose_rmse_dy": 0.1044737696647644,
      "pose_rmse_mean": 0.1416040062904358,
      "rmse_dtheta": 0.02870788984000683,
      "rmse_dx": 0.008443423546850681,
      "rmse_dy": 0.008880091831088066,
      "rmse_mean": 0.015343802981078625,
      "rotation_flip": 0.008253968320786953,
      "sparse_tokens": 32121.0,
      "step": 5670,
      "turn_loss": 0.15042738616466522,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.26347333209440627,
      "grad_norm": 0.43587908148765564,
      "learning_rate": 5.514751806519673e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.02422047033905983,
      "mae_dx": 0.0053398339077830315,
      "mae_dy": 0.007260330952703953,
      "pose_mae_dtheta": 0.1660558432340622,
      "pose_mae_dx": 0.07062598317861557,
      "pose_mae_dy": 0.102965347468853,
      "pose_rmse_dtheta": 0.32000285387039185,
      "pose_rmse_dx": 0.16692638397216797,
      "pose_rmse_dy": 0.19818450510501862,
      "pose_rmse_mean": 0.2283712476491928,
      "rmse_dtheta": 0.04401450976729393,
      "rmse_dx": 0.014282213523983955,
      "rmse_dy": 0.013685919344425201,
      "rmse_mean": 0.023994214832782745,
      "rotation_flip": 0.0038910505827516317,
      "sparse_tokens": 4861.0,
      "step": 5671,
      "turn_loss": 0.16534638404846191,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.26351979186024904,
      "grad_norm": 0.6641587615013123,
      "learning_rate": 5.51343659502438e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.031692277640104294,
      "mae_dx": 0.01406123023480177,
      "mae_dy": 0.00500252703204751,
      "pose_mae_dtheta": 0.22862398624420166,
      "pose_mae_dx": 0.11296717822551727,
      "pose_mae_dy": 0.07194174081087112,
      "pose_rmse_dtheta": 0.3774886727333069,
      "pose_rmse_dx": 0.24674372375011444,
      "pose_rmse_dy": 0.1991867572069168,
      "pose_rmse_mean": 0.27447307109832764,
      "rmse_dtheta": 0.047628890722990036,
      "rmse_dx": 0.027022168040275574,
      "rmse_dy": 0.011235406622290611,
      "rmse_mean": 0.028628824278712273,
      "rotation_flip": 0.009334889240562916,
      "sparse_tokens": 13779.0,
      "step": 5672,
      "turn_loss": 0.26097944378852844,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2635662516260918,
      "grad_norm": 0.7548537254333496,
      "learning_rate": 5.512121347624189e-06,
      "loss": 0.1482,
      "mae_dtheta": 0.011077762581408024,
      "mae_dx": 0.0015850082272663713,
      "mae_dy": 0.002966222818940878,
      "pose_mae_dtheta": 0.07582566142082214,
      "pose_mae_dx": 0.027776479721069336,
      "pose_mae_dy": 0.03775906190276146,
      "pose_rmse_dtheta": 0.181974858045578,
      "pose_rmse_dx": 0.06917040795087814,
      "pose_rmse_dy": 0.1038513034582138,
      "pose_rmse_mean": 0.11833219230175018,
      "rmse_dtheta": 0.02248522639274597,
      "rmse_dx": 0.004275903571397066,
      "rmse_dy": 0.006574735511094332,
      "rmse_mean": 0.011111955158412457,
      "rotation_flip": 0.0029444240499287844,
      "sparse_tokens": 32073.0,
      "step": 5673,
      "turn_loss": 0.09779685735702515,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.2636127113919346,
      "grad_norm": 0.5236997008323669,
      "learning_rate": 5.5108060644110784e-06,
      "loss": 0.1536,
      "mae_dtheta": 0.028980525210499763,
      "mae_dx": 0.009904582984745502,
      "mae_dy": 0.003752937773242593,
      "pose_mae_dtheta": 0.23354177176952362,
      "pose_mae_dx": 0.07591630518436432,
      "pose_mae_dy": 0.04737914353609085,
      "pose_rmse_dtheta": 0.4343198537826538,
      "pose_rmse_dx": 0.1847003549337387,
      "pose_rmse_dy": 0.13809798657894135,
      "pose_rmse_mean": 0.25237274169921875,
      "rmse_dtheta": 0.047762494534254074,
      "rmse_dx": 0.021691126748919487,
      "rmse_dy": 0.009903818368911743,
      "rmse_mean": 0.026452479884028435,
      "rotation_flip": 0.011006289161741734,
      "sparse_tokens": 26391.0,
      "step": 5674,
      "turn_loss": 0.20787324011325836,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.26365917115777737,
      "grad_norm": 0.7585541605949402,
      "learning_rate": 5.509490745477025e-06,
      "loss": 0.1226,
      "mae_dtheta": 0.012230059131979942,
      "mae_dx": 0.002573733450844884,
      "mae_dy": 0.003355468390509486,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7585541009902954,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.6128387451172,
      "model/head/act_norm_mean": 112.07197956123737,
      "model/head/act_norm_min": 55.78506088256836,
      "model/head/act_over_embed": 77.01691358888593,
      "model/head/grad_frac": 0.07227638363838196,
      "model/head/grad_norm": 0.0548255480825901,
      "model/head/grad_zero_frac": 0.0001611740590305999,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7016996133207071,
      "model/head/update_ratio": 0.0009374009096063673,
      "model/head/weight_delta": 8.739888191223145,
      "model/head/weight_delta_rel": 0.15332353115081787,
      "model/head/weight_norm": 58.48676681518555,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4207811653614044,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.420718093803026,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42065098881721497,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28912141288629084,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10246368497610092,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07772424817085266,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5401053450226244,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0025127960834652185,
      "model/modality_embedder.encoders.pose/weight_delta": 2.851348400115967,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09316243976354599,
      "model/modality_embedder.encoders.pose/weight_norm": 30.931379318237305,
      "model/modality_embedder/grad_frac": 0.10246368497610092,
      "model/modality_embedder/grad_norm": 0.07772424817085266,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5401053450226244,
      "model/modality_embedder/update_ratio": 0.0025127960834652185,
      "model/modality_embedder/weight_delta": 2.851348400115967,
      "model/modality_embedder/weight_delta_rel": 0.09316243976354599,
      "model/modality_embedder/weight_norm": 30.931379318237305,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.69091033935547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.832436467853135,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.97781753540039,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.377873463494243,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.050676800310611725,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.038441095501184464,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013805493945255876,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.203115224838257,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08028284460306168,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.84477996826172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.31262969970703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.829197230238897,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.217052459716797,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.06285679122702,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05064446106553078,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03841656446456909,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012988108210265636,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.791726589202881,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09670758992433548,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.57826042175293,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.0550537109375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.702363415905083,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.449331283569336,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.350114130874953,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05546741560101509,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.042075034230947495,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001377810607664287,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.0093960762023926,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10104988515377045,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.5376033782959,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.72579193115234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.530122655122653,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.689266204833984,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.606167391816864,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05768362805247307,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.043756153434515,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014681993052363396,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.5690972805023193,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0877995565533638,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.80259895324707,
      "model/normalizer/grad_frac": 0.20073918998241425,
      "model/normalizer/grad_norm": 0.15227153897285461,
      "model/normalizer/grad_zero_frac": 0.00017489728634245694,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001941191265359521,
      "model/normalizer/weight_delta": 5.444278240203857,
      "model/normalizer/weight_delta_rel": 0.07011914998292923,
      "model/normalizer/weight_norm": 78.44231414794922,
      "pose_mae_dtheta": 0.08549517393112183,
      "pose_mae_dx": 0.03357759490609169,
      "pose_mae_dy": 0.03371281921863556,
      "pose_rmse_dtheta": 0.20430094003677368,
      "pose_rmse_dx": 0.08349186927080154,
      "pose_rmse_dy": 0.08287563174962997,
      "pose_rmse_mean": 0.12355615198612213,
      "rmse_dtheta": 0.025998571887612343,
      "rmse_dx": 0.007833843119442463,
      "rmse_dy": 0.007979503832757473,
      "rmse_mean": 0.013937307521700859,
      "rotation_flip": 0.0028490028344094753,
      "sparse_tokens": 32089.0,
      "step": 5675,
      "turn_loss": 0.11315485090017319,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.26370563092362015,
      "grad_norm": 0.4885556399822235,
      "learning_rate": 5.50817539091401e-06,
      "loss": 0.0689,
      "mae_dtheta": 0.02514559030532837,
      "mae_dx": 0.007530638016760349,
      "mae_dy": 0.006204606499522924,
      "pose_mae_dtheta": 0.18359969556331635,
      "pose_mae_dx": 0.04745302349328995,
      "pose_mae_dy": 0.08272052556276321,
      "pose_rmse_dtheta": 0.3132760524749756,
      "pose_rmse_dx": 0.08922048658132553,
      "pose_rmse_dy": 0.1913442462682724,
      "pose_rmse_mean": 0.1979469358921051,
      "rmse_dtheta": 0.04014692083001137,
      "rmse_dx": 0.017590347677469254,
      "rmse_dy": 0.011432886123657227,
      "rmse_mean": 0.023056719452142715,
      "rotation_flip": 0.010204081423580647,
      "sparse_tokens": 4752.0,
      "step": 5676,
      "turn_loss": 0.3007243871688843,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.2637520906894629,
      "grad_norm": 0.5490525960922241,
      "learning_rate": 5.506860000814017e-06,
      "loss": 0.1317,
      "mae_dtheta": 0.033478930592536926,
      "mae_dx": 0.014663430862128735,
      "mae_dy": 0.007328266743570566,
      "pose_mae_dtheta": 0.2538861632347107,
      "pose_mae_dx": 0.117862269282341,
      "pose_mae_dy": 0.07799793034791946,
      "pose_rmse_dtheta": 0.43071478605270386,
      "pose_rmse_dx": 0.22227968275547028,
      "pose_rmse_dy": 0.1671530306339264,
      "pose_rmse_mean": 0.2733825147151947,
      "rmse_dtheta": 0.050490252673625946,
      "rmse_dx": 0.026880834251642227,
      "rmse_dy": 0.016644828021526337,
      "rmse_mean": 0.0313386395573616,
      "rotation_flip": 0.017913592979311943,
      "sparse_tokens": 15802.0,
      "step": 5677,
      "turn_loss": 0.35737156867980957,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.2637985504553057,
      "grad_norm": 0.918351948261261,
      "learning_rate": 5.505544575269034e-06,
      "loss": 0.1608,
      "mae_dtheta": 0.039349962025880814,
      "mae_dx": 0.011212543584406376,
      "mae_dy": 0.009373749606311321,
      "pose_mae_dtheta": 0.2987331748008728,
      "pose_mae_dx": 0.12144283950328827,
      "pose_mae_dy": 0.12649336457252502,
      "pose_rmse_dtheta": 0.530613124370575,
      "pose_rmse_dx": 0.265631765127182,
      "pose_rmse_dy": 0.2570667564868927,
      "pose_rmse_mean": 0.35110387206077576,
      "rmse_dtheta": 0.05569818243384361,
      "rmse_dx": 0.024431690573692322,
      "rmse_dy": 0.015645267441868782,
      "rmse_mean": 0.03192504867911339,
      "rotation_flip": 0.0030581040773540735,
      "sparse_tokens": 5792.0,
      "step": 5678,
      "turn_loss": 0.34267058968544006,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.2638450102211485,
      "grad_norm": 0.5319161415100098,
      "learning_rate": 5.5042291143710454e-06,
      "loss": 0.1195,
      "mae_dtheta": 0.0367746539413929,
      "mae_dx": 0.014960315078496933,
      "mae_dy": 0.0031538852490484715,
      "pose_mae_dtheta": 0.30297839641571045,
      "pose_mae_dx": 0.11572248488664627,
      "pose_mae_dy": 0.037699755281209946,
      "pose_rmse_dtheta": 0.4926025867462158,
      "pose_rmse_dx": 0.25648877024650574,
      "pose_rmse_dy": 0.09576261788606644,
      "pose_rmse_mean": 0.28161799907684326,
      "rmse_dtheta": 0.053309936076402664,
      "rmse_dx": 0.028741834685206413,
      "rmse_dy": 0.006946169305592775,
      "rmse_mean": 0.029665980488061905,
      "rotation_flip": 0.016885552555322647,
      "sparse_tokens": 17791.0,
      "step": 5679,
      "turn_loss": 0.25234323740005493,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.26389146998699126,
      "grad_norm": 0.4756595194339752,
      "learning_rate": 5.502913618212046e-06,
      "loss": 0.088,
      "mae_dtheta": 0.03560756519436836,
      "mae_dx": 0.014391650445759296,
      "mae_dy": 0.002842474728822708,
      "pose_mae_dtheta": 0.27635958790779114,
      "pose_mae_dx": 0.11736911535263062,
      "pose_mae_dy": 0.03188449144363403,
      "pose_rmse_dtheta": 0.5226737260818481,
      "pose_rmse_dx": 0.26900598406791687,
      "pose_rmse_dy": 0.079849973320961,
      "pose_rmse_mean": 0.2905099093914032,
      "rmse_dtheta": 0.05565517023205757,
      "rmse_dx": 0.028147945180535316,
      "rmse_dy": 0.005811612121760845,
      "rmse_mean": 0.02987157553434372,
      "rotation_flip": 0.005484460853040218,
      "sparse_tokens": 9937.0,
      "step": 5680,
      "turn_loss": 0.26875802874565125,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.26393792975283403,
      "grad_norm": 0.7176546454429626,
      "learning_rate": 5.5015980868840254e-06,
      "loss": 0.1639,
      "mae_dtheta": 0.03834076598286629,
      "mae_dx": 0.014743468724191189,
      "mae_dy": 0.006285113748162985,
      "pose_mae_dtheta": 0.31927573680877686,
      "pose_mae_dx": 0.11386783421039581,
      "pose_mae_dy": 0.08513934910297394,
      "pose_rmse_dtheta": 0.5395993590354919,
      "pose_rmse_dx": 0.24031409621238708,
      "pose_rmse_dy": 0.18072748184204102,
      "pose_rmse_mean": 0.32021364569664,
      "rmse_dtheta": 0.055520199239254,
      "rmse_dx": 0.028053227812051773,
      "rmse_dy": 0.011596102267503738,
      "rmse_mean": 0.031723178923130035,
      "rotation_flip": 0.007614213041961193,
      "sparse_tokens": 20656.0,
      "step": 5681,
      "turn_loss": 0.30248498916625977,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.2639843895186768,
      "grad_norm": 0.5479716062545776,
      "learning_rate": 5.5002825204789825e-06,
      "loss": 0.1133,
      "mae_dtheta": 0.03454184904694557,
      "mae_dx": 0.018065936863422394,
      "mae_dy": 0.004501129034906626,
      "pose_mae_dtheta": 0.26476094126701355,
      "pose_mae_dx": 0.1491728574037552,
      "pose_mae_dy": 0.06061356142163277,
      "pose_rmse_dtheta": 0.466227263212204,
      "pose_rmse_dx": 0.2970294654369354,
      "pose_rmse_dy": 0.14282235503196716,
      "pose_rmse_mean": 0.3020263612270355,
      "rmse_dtheta": 0.05360858514904976,
      "rmse_dx": 0.03226131945848465,
      "rmse_dy": 0.00900273583829403,
      "rmse_mean": 0.031624216586351395,
      "rotation_flip": 0.015094339847564697,
      "sparse_tokens": 8763.0,
      "step": 5682,
      "turn_loss": 0.2798064053058624,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 29431.0,
      "epoch": 0.2640308492845196,
      "grad_norm": 0.4682629108428955,
      "learning_rate": 5.498966919088914e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.031378284096717834,
      "mae_dx": 0.011451042257249355,
      "mae_dy": 0.006388777866959572,
      "pose_mae_dtheta": 0.25860244035720825,
      "pose_mae_dx": 0.09332688897848129,
      "pose_mae_dy": 0.07075131684541702,
      "pose_rmse_dtheta": 0.44124317169189453,
      "pose_rmse_dx": 0.20084349811077118,
      "pose_rmse_dy": 0.17391644418239594,
      "pose_rmse_mean": 0.2720010578632355,
      "rmse_dtheta": 0.04886673018336296,
      "rmse_dx": 0.023277364671230316,
      "rmse_dy": 0.013327051885426044,
      "rmse_mean": 0.028490383177995682,
      "rotation_flip": 0.009908536449074745,
      "sparse_tokens": 22827.0,
      "step": 5683,
      "turn_loss": 0.2756696939468384,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.26407730905036236,
      "grad_norm": 0.34150856733322144,
      "learning_rate": 5.497651282805821e-06,
      "loss": 0.0882,
      "mae_dtheta": 0.008646679110825062,
      "mae_dx": 0.0012186812236905098,
      "mae_dy": 0.000275612372206524,
      "pose_mae_dtheta": 0.06734658032655716,
      "pose_mae_dx": 0.009252602234482765,
      "pose_mae_dy": 0.003674586769193411,
      "pose_rmse_dtheta": 0.297305703163147,
      "pose_rmse_dx": 0.022858353331685066,
      "pose_rmse_dy": 0.011490968056023121,
      "pose_rmse_mean": 0.11055167764425278,
      "rmse_dtheta": 0.031981851905584335,
      "rmse_dx": 0.003469529328867793,
      "rmse_dy": 0.0006626785034313798,
      "rmse_mean": 0.01203802041709423,
      "rotation_flip": 0.0006238303030841053,
      "sparse_tokens": 32201.0,
      "step": 5684,
      "turn_loss": 0.044870298355817795,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.26412376881620514,
      "grad_norm": 0.47368255257606506,
      "learning_rate": 5.496335611721707e-06,
      "loss": 0.0795,
      "mae_dtheta": 0.010139604099094868,
      "mae_dx": 0.0015666208928450942,
      "mae_dy": 0.0021427227184176445,
      "pose_mae_dtheta": 0.06986590474843979,
      "pose_mae_dx": 0.024899329990148544,
      "pose_mae_dy": 0.03220929950475693,
      "pose_rmse_dtheta": 0.14375253021717072,
      "pose_rmse_dx": 0.06321381032466888,
      "pose_rmse_dy": 0.07670892030000687,
      "pose_rmse_mean": 0.09455841779708862,
      "rmse_dtheta": 0.020434150472283363,
      "rmse_dx": 0.005317755043506622,
      "rmse_dy": 0.00431698327884078,
      "rmse_mean": 0.010022963397204876,
      "rotation_flip": 0.002053388161584735,
      "sparse_tokens": 32073.0,
      "step": 5685,
      "turn_loss": 0.07613486796617508,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.264170228582048,
      "grad_norm": 0.687659502029419,
      "learning_rate": 5.495019905928578e-06,
      "loss": 0.1625,
      "mae_dtheta": 0.006680149585008621,
      "mae_dx": 0.0027941924054175615,
      "mae_dy": 0.0019649185705929995,
      "pose_mae_dtheta": 0.04576467350125313,
      "pose_mae_dx": 0.027159374207258224,
      "pose_mae_dy": 0.017102662473917007,
      "pose_rmse_dtheta": 0.11974161863327026,
      "pose_rmse_dx": 0.07147089391946793,
      "pose_rmse_dy": 0.041334640234708786,
      "pose_rmse_mean": 0.07751572132110596,
      "rmse_dtheta": 0.018566520884633064,
      "rmse_dx": 0.009063337929546833,
      "rmse_dy": 0.005659153219312429,
      "rmse_mean": 0.01109633781015873,
      "rotation_flip": 0.0018876828253269196,
      "sparse_tokens": 32121.0,
      "step": 5686,
      "turn_loss": 0.09077133983373642,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.26421668834789075,
      "grad_norm": 0.5252135396003723,
      "learning_rate": 5.493704165518439e-06,
      "loss": 0.1088,
      "mae_dtheta": 0.015127263031899929,
      "mae_dx": 0.0028606541454792023,
      "mae_dy": 0.003323907498270273,
      "pose_mae_dtheta": 0.10328049212694168,
      "pose_mae_dx": 0.026953095570206642,
      "pose_mae_dy": 0.03482140973210335,
      "pose_rmse_dtheta": 0.23657849431037903,
      "pose_rmse_dx": 0.059159163385629654,
      "pose_rmse_dy": 0.07127019017934799,
      "pose_rmse_mean": 0.12233595550060272,
      "rmse_dtheta": 0.028785444796085358,
      "rmse_dx": 0.008273941464722157,
      "rmse_dy": 0.00772780692204833,
      "rmse_mean": 0.014929063618183136,
      "rotation_flip": 0.00546075077727437,
      "sparse_tokens": 32153.0,
      "step": 5687,
      "turn_loss": 0.1379188746213913,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.2642631481137335,
      "grad_norm": 0.7247112989425659,
      "learning_rate": 5.492388390583306e-06,
      "loss": 0.14,
      "mae_dtheta": 0.012523181736469269,
      "mae_dx": 0.00320830219425261,
      "mae_dy": 0.0010646155569702387,
      "pose_mae_dtheta": 0.09399861097335815,
      "pose_mae_dx": 0.02740325592458248,
      "pose_mae_dy": 0.015472599305212498,
      "pose_rmse_dtheta": 0.2726806104183197,
      "pose_rmse_dx": 0.0677584633231163,
      "pose_rmse_dy": 0.049312349408864975,
      "pose_rmse_mean": 0.12991714477539062,
      "rmse_dtheta": 0.031531162559986115,
      "rmse_dx": 0.008573278784751892,
      "rmse_dy": 0.0028424947522580624,
      "rmse_mean": 0.014315645210444927,
      "rotation_flip": 0.004110997077077627,
      "sparse_tokens": 32233.0,
      "step": 5688,
      "turn_loss": 0.1084112897515297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2643096078795763,
      "grad_norm": 0.5476681590080261,
      "learning_rate": 5.491072581215186e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.012000278569757938,
      "mae_dx": 0.0019795638509094715,
      "mae_dy": 0.0033709376584738493,
      "pose_mae_dtheta": 0.08137470483779907,
      "pose_mae_dx": 0.02239147014915943,
      "pose_mae_dy": 0.03392227366566658,
      "pose_rmse_dtheta": 0.1835196614265442,
      "pose_rmse_dx": 0.052801117300987244,
      "pose_rmse_dy": 0.08256322890520096,
      "pose_rmse_mean": 0.1062946766614914,
      "rmse_dtheta": 0.02388823591172695,
      "rmse_dx": 0.00595676526427269,
      "rmse_dy": 0.007951299659907818,
      "rmse_mean": 0.012598766945302486,
      "rotation_flip": 0.010442046448588371,
      "sparse_tokens": 32137.0,
      "step": 5689,
      "turn_loss": 0.11793579906225204,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2643560676454191,
      "grad_norm": 1.0404654741287231,
      "learning_rate": 5.4897567375060975e-06,
      "loss": 0.238,
      "mae_dtheta": 0.016099968925118446,
      "mae_dx": 0.004495032597333193,
      "mae_dy": 0.005279456730931997,
      "pose_mae_dtheta": 0.12607306241989136,
      "pose_mae_dx": 0.049030959606170654,
      "pose_mae_dy": 0.053275588899850845,
      "pose_rmse_dtheta": 0.30806970596313477,
      "pose_rmse_dx": 0.18141086399555206,
      "pose_rmse_dy": 0.17079046368598938,
      "pose_rmse_mean": 0.2200903594493866,
      "rmse_dtheta": 0.03340493515133858,
      "rmse_dx": 0.016923675313591957,
      "rmse_dy": 0.01414596475660801,
      "rmse_mean": 0.021491525694727898,
      "rotation_flip": 0.009723260998725891,
      "sparse_tokens": 32089.0,
      "step": 5690,
      "turn_loss": 0.1862604171037674,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.26440252741126186,
      "grad_norm": 0.5453821420669556,
      "learning_rate": 5.488440859548059e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.008761681616306305,
      "mae_dx": 0.001500350539572537,
      "mae_dy": 0.0011914190836250782,
      "pose_mae_dtheta": 0.06406034529209137,
      "pose_mae_dx": 0.014771678484976292,
      "pose_mae_dy": 0.018257616087794304,
      "pose_rmse_dtheta": 0.1981075555086136,
      "pose_rmse_dx": 0.039796993136405945,
      "pose_rmse_dy": 0.052300699055194855,
      "pose_rmse_mean": 0.09673508256673813,
      "rmse_dtheta": 0.023112036287784576,
      "rmse_dx": 0.00508029293268919,
      "rmse_dy": 0.0030717423651367426,
      "rmse_mean": 0.010421358048915863,
      "rotation_flip": 0.0019286402966827154,
      "sparse_tokens": 32105.0,
      "step": 5691,
      "turn_loss": 0.06286252290010452,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.26444898717710463,
      "grad_norm": 0.5319010615348816,
      "learning_rate": 5.487124947433087e-06,
      "loss": 0.0973,
      "mae_dtheta": 0.031350914388895035,
      "mae_dx": 0.010144172236323357,
      "mae_dy": 0.0057168323546648026,
      "pose_mae_dtheta": 0.2687135934829712,
      "pose_mae_dx": 0.0717814713716507,
      "pose_mae_dy": 0.09362592548131943,
      "pose_rmse_dtheta": 0.45300766825675964,
      "pose_rmse_dx": 0.17096905410289764,
      "pose_rmse_dy": 0.1912112683057785,
      "pose_rmse_mean": 0.27172935009002686,
      "rmse_dtheta": 0.04612472653388977,
      "rmse_dx": 0.02175690419971943,
      "rmse_dy": 0.010047501884400845,
      "rmse_mean": 0.025976378470659256,
      "rotation_flip": 0.02484472095966339,
      "sparse_tokens": 6951.0,
      "step": 5692,
      "turn_loss": 0.27065300941467285,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2644954469429474,
      "grad_norm": 0.5710080862045288,
      "learning_rate": 5.485809001253207e-06,
      "loss": 0.0921,
      "mae_dtheta": 0.009822089225053787,
      "mae_dx": 0.0014040026580914855,
      "mae_dy": 0.002578074811026454,
      "pose_mae_dtheta": 0.06915528327226639,
      "pose_mae_dx": 0.022322257980704308,
      "pose_mae_dy": 0.034010063856840134,
      "pose_rmse_dtheta": 0.18345898389816284,
      "pose_rmse_dx": 0.0653022974729538,
      "pose_rmse_dy": 0.10843118280172348,
      "pose_rmse_mean": 0.11906415224075317,
      "rmse_dtheta": 0.02282078005373478,
      "rmse_dx": 0.00401765713468194,
      "rmse_dy": 0.007271876558661461,
      "rmse_mean": 0.011370105668902397,
      "rotation_flip": 0.005734450649470091,
      "sparse_tokens": 32073.0,
      "step": 5693,
      "turn_loss": 0.08492793142795563,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.2645419067087902,
      "grad_norm": 0.8527566194534302,
      "learning_rate": 5.484493021100442e-06,
      "loss": 0.1306,
      "mae_dtheta": 0.03690769523382187,
      "mae_dx": 0.01124516874551773,
      "mae_dy": 0.01101116556674242,
      "pose_mae_dtheta": 0.3053511679172516,
      "pose_mae_dx": 0.07081993669271469,
      "pose_mae_dy": 0.09331301599740982,
      "pose_rmse_dtheta": 0.5246014595031738,
      "pose_rmse_dx": 0.1398259401321411,
      "pose_rmse_dy": 0.21967419981956482,
      "pose_rmse_mean": 0.294700562953949,
      "rmse_dtheta": 0.05453964322805405,
      "rmse_dx": 0.020577846094965935,
      "rmse_dy": 0.02361767366528511,
      "rmse_mean": 0.03291172534227371,
      "rotation_flip": 0.013232514262199402,
      "sparse_tokens": 8489.0,
      "step": 5694,
      "turn_loss": 0.41325268149375916,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.26458836647463296,
      "grad_norm": 0.4814712405204773,
      "learning_rate": 5.48317700706682e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.012227250263094902,
      "mae_dx": 0.001914258929900825,
      "mae_dy": 0.003786971792578697,
      "pose_mae_dtheta": 0.08725497126579285,
      "pose_mae_dx": 0.03340521827340126,
      "pose_mae_dy": 0.043378859758377075,
      "pose_rmse_dtheta": 0.18444208800792694,
      "pose_rmse_dx": 0.07757902145385742,
      "pose_rmse_dy": 0.10503757745027542,
      "pose_rmse_mean": 0.12235289812088013,
      "rmse_dtheta": 0.0237297210842371,
      "rmse_dx": 0.004622113425284624,
      "rmse_dy": 0.00772790377959609,
      "rmse_mean": 0.012026580050587654,
      "rotation_flip": 0.008365283720195293,
      "sparse_tokens": 32121.0,
      "step": 5695,
      "turn_loss": 0.09550907462835312,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.26463482624047574,
      "grad_norm": 0.33839064836502075,
      "learning_rate": 5.48186095924437e-06,
      "loss": 0.0694,
      "mae_dtheta": 0.00582149950787425,
      "mae_dx": 0.0013349573127925396,
      "mae_dy": 0.0007458102190867066,
      "pose_mae_dtheta": 0.04241497814655304,
      "pose_mae_dx": 0.011825142428278923,
      "pose_mae_dy": 0.010997423902153969,
      "pose_rmse_dtheta": 0.15211667120456696,
      "pose_rmse_dx": 0.05427387356758118,
      "pose_rmse_dy": 0.023913303390145302,
      "pose_rmse_mean": 0.0767679512500763,
      "rmse_dtheta": 0.019011374562978745,
      "rmse_dx": 0.005842318292707205,
      "rmse_dy": 0.0015219126362353563,
      "rmse_mean": 0.008791869506239891,
      "rotation_flip": 0.002782415132969618,
      "sparse_tokens": 32137.0,
      "step": 5696,
      "turn_loss": 0.03904184699058533,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2646812860063185,
      "grad_norm": 0.47219157218933105,
      "learning_rate": 5.480544877725127e-06,
      "loss": 0.0827,
      "mae_dtheta": 0.010075928643345833,
      "mae_dx": 0.0020119771361351013,
      "mae_dy": 0.0022397462744265795,
      "pose_mae_dtheta": 0.07170654833316803,
      "pose_mae_dx": 0.017949270084500313,
      "pose_mae_dy": 0.01887587644159794,
      "pose_rmse_dtheta": 0.22710853815078735,
      "pose_rmse_dx": 0.0625179186463356,
      "pose_rmse_dy": 0.051461268216371536,
      "pose_rmse_mean": 0.1136959120631218,
      "rmse_dtheta": 0.027725813910365105,
      "rmse_dx": 0.008130687288939953,
      "rmse_dy": 0.006917024962604046,
      "rmse_mean": 0.014257842674851418,
      "rotation_flip": 0.003970004618167877,
      "sparse_tokens": 32169.0,
      "step": 5697,
      "turn_loss": 0.07810025662183762,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.2647277457721613,
      "grad_norm": 0.5975515842437744,
      "learning_rate": 5.4792287626011206e-06,
      "loss": 0.233,
      "mae_dtheta": 0.04346071556210518,
      "mae_dx": 0.01877281256020069,
      "mae_dy": 0.0069901105016469955,
      "pose_mae_dtheta": 0.39953935146331787,
      "pose_mae_dx": 0.15889257192611694,
      "pose_mae_dy": 0.0866013839840889,
      "pose_rmse_dtheta": 0.612162172794342,
      "pose_rmse_dx": 0.31325048208236694,
      "pose_rmse_dy": 0.20253346860408783,
      "pose_rmse_mean": 0.37598204612731934,
      "rmse_dtheta": 0.05822138860821724,
      "rmse_dx": 0.0321563258767128,
      "rmse_dy": 0.01479919534176588,
      "rmse_mean": 0.035058971494436264,
      "rotation_flip": 0.006784260738641024,
      "sparse_tokens": 12695.0,
      "step": 5698,
      "turn_loss": 0.3708445429801941,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.26477420553800407,
      "grad_norm": 0.5339081287384033,
      "learning_rate": 5.47791261396439e-06,
      "loss": 0.1664,
      "mae_dtheta": 0.010543703101575375,
      "mae_dx": 0.0017962738638743758,
      "mae_dy": 0.0036639482714235783,
      "pose_mae_dtheta": 0.07001503556966782,
      "pose_mae_dx": 0.026247769594192505,
      "pose_mae_dy": 0.033783264458179474,
      "pose_rmse_dtheta": 0.16831998527050018,
      "pose_rmse_dx": 0.06490843743085861,
      "pose_rmse_dy": 0.06963829696178436,
      "pose_rmse_mean": 0.10095556825399399,
      "rmse_dtheta": 0.020869050174951553,
      "rmse_dx": 0.0049501401372253895,
      "rmse_dy": 0.00797217059880495,
      "rmse_mean": 0.011263786815106869,
      "rotation_flip": 0.00487073790282011,
      "sparse_tokens": 32057.0,
      "step": 5699,
      "turn_loss": 0.10037944465875626,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.26482066530384685,
      "grad_norm": 0.4450644552707672,
      "learning_rate": 5.476596431906975e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.022957254201173782,
      "mae_dx": 0.008713562972843647,
      "mae_dy": 0.006581946741789579,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44506439566612244,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.1172637939453,
      "model/head/act_norm_mean": 119.12544221698113,
      "model/head/act_norm_min": 82.23612213134766,
      "model/head/act_over_embed": 81.86411916147082,
      "model/head/grad_frac": 0.10396473109722137,
      "model/head/grad_norm": 0.04627100005745888,
      "model/head/grad_zero_frac": 0.0001856039889389649,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6984817216981132,
      "model/head/update_ratio": 0.000791093974839896,
      "model/head/weight_delta": 8.75601863861084,
      "model/head/weight_delta_rel": 0.15360650420188904,
      "model/head/weight_norm": 58.489891052246094,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42083704471588135,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4207914140489366,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42074236273765564,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28917179924571557,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07840487360954285,
      "model/modality_embedder.encoders.pose/grad_norm": 0.034895218908786774,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5257523148148148,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011281369952484965,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8583617210388184,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09339158982038498,
      "model/modality_embedder.encoders.pose/weight_norm": 30.931720733642578,
      "model/modality_embedder/grad_frac": 0.07840487360954285,
      "model/modality_embedder/grad_norm": 0.034895218908786774,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5257523148148148,
      "model/modality_embedder/update_ratio": 0.0011281369952484965,
      "model/modality_embedder/weight_delta": 2.8583617210388184,
      "model/modality_embedder/weight_delta_rel": 0.09339158982038498,
      "model/modality_embedder/weight_norm": 30.931720733642578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.92339324951172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.42025353773585,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.070863723754883,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.781826857147756,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08967865258455276,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03991277515888214,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014333573635667562,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.2087271213531494,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08048734813928604,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.84565544128418,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.16592407226562,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.226527403414195,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.390908241271973,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.335905806096775,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08381747454404831,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03730417415499687,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012611299753189087,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.798924684524536,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09695693850517273,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.579959869384766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.67195129394531,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.87950874138964,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.909421920776367,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.471850057008606,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09004688262939453,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.040076661854982376,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013122697127982974,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.01721453666687,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10131241381168365,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.53995704650879,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.12216186523438,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.80600245208146,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.995285987854004,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.79575457111431,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09912677109241486,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.044117797166109085,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001480251201428473,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.576077699661255,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08803810924291611,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.804264068603516,
      "model/normalizer/grad_frac": 0.39313361048698425,
      "model/normalizer/grad_norm": 0.17496977746486664,
      "model/normalizer/grad_zero_frac": 0.00017253380792681128,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0022304903250187635,
      "model/normalizer/weight_delta": 5.458400726318359,
      "model/normalizer/weight_delta_rel": 0.07030104100704193,
      "model/normalizer/weight_norm": 78.44453430175781,
      "pose_mae_dtheta": 0.1758759617805481,
      "pose_mae_dx": 0.0655103549361229,
      "pose_mae_dy": 0.09411653131246567,
      "pose_rmse_dtheta": 0.3044130206108093,
      "pose_rmse_dx": 0.16151060163974762,
      "pose_rmse_dy": 0.19549821317195892,
      "pose_rmse_mean": 0.22047394514083862,
      "rmse_dtheta": 0.03743625804781914,
      "rmse_dx": 0.021772002801299095,
      "rmse_dy": 0.012027379125356674,
      "rmse_mean": 0.023745214566588402,
      "rotation_flip": 0.015256588347256184,
      "sparse_tokens": 13941.0,
      "step": 5700,
      "turn_loss": 0.1838192641735077,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 32114.0,
      "epoch": 0.2648671250696896,
      "grad_norm": 0.43236204981803894,
      "learning_rate": 5.475280216520913e-06,
      "loss": 0.104,
      "mae_dtheta": 0.026690557599067688,
      "mae_dx": 0.010031773708760738,
      "mae_dy": 0.00491277314722538,
      "pose_mae_dtheta": 0.2243908941745758,
      "pose_mae_dx": 0.08062510937452316,
      "pose_mae_dy": 0.06231803447008133,
      "pose_rmse_dtheta": 0.4102790951728821,
      "pose_rmse_dx": 0.19384650886058807,
      "pose_rmse_dy": 0.1672157496213913,
      "pose_rmse_mean": 0.25711381435394287,
      "rmse_dtheta": 0.04329211637377739,
      "rmse_dx": 0.021783655509352684,
      "rmse_dy": 0.010942299850285053,
      "rmse_mean": 0.025339357554912567,
      "rotation_flip": 0.014795474708080292,
      "sparse_tokens": 26954.0,
      "step": 5701,
      "turn_loss": 0.2025892436504364,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.26491358483553246,
      "grad_norm": 0.5517499446868896,
      "learning_rate": 5.473963967898253e-06,
      "loss": 0.126,
      "mae_dtheta": 0.01312553882598877,
      "mae_dx": 0.002729617292061448,
      "mae_dy": 0.0028681252151727676,
      "pose_mae_dtheta": 0.09157371520996094,
      "pose_mae_dx": 0.03480291739106178,
      "pose_mae_dy": 0.034943029284477234,
      "pose_rmse_dtheta": 0.21494528651237488,
      "pose_rmse_dx": 0.09007030725479126,
      "pose_rmse_dy": 0.0852229967713356,
      "pose_rmse_mean": 0.13007953763008118,
      "rmse_dtheta": 0.027672598138451576,
      "rmse_dx": 0.00807031337171793,
      "rmse_dy": 0.007149040699005127,
      "rmse_mean": 0.01429731771349907,
      "rotation_flip": 0.004743423778563738,
      "sparse_tokens": 32105.0,
      "step": 5702,
      "turn_loss": 0.13331063091754913,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.26496004460137523,
      "grad_norm": 0.410101056098938,
      "learning_rate": 5.472647686131037e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.005999954417347908,
      "mae_dx": 0.0014299631584435701,
      "mae_dy": 0.0015777735970914364,
      "pose_mae_dtheta": 0.04464888945221901,
      "pose_mae_dx": 0.016773102805018425,
      "pose_mae_dy": 0.01828620955348015,
      "pose_rmse_dtheta": 0.15670011937618256,
      "pose_rmse_dx": 0.04512185603380203,
      "pose_rmse_dy": 0.04615503177046776,
      "pose_rmse_mean": 0.08265900611877441,
      "rmse_dtheta": 0.018322717398405075,
      "rmse_dx": 0.004362946841865778,
      "rmse_dy": 0.004417832940816879,
      "rmse_mean": 0.009034499526023865,
      "rotation_flip": 0.002900232095271349,
      "sparse_tokens": 32073.0,
      "step": 5703,
      "turn_loss": 0.05118976905941963,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.265006504367218,
      "grad_norm": 0.41221240162849426,
      "learning_rate": 5.471331371311315e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.028028203174471855,
      "mae_dx": 0.01544160395860672,
      "mae_dy": 0.007126891985535622,
      "pose_mae_dtheta": 0.2014213651418686,
      "pose_mae_dx": 0.1362113058567047,
      "pose_mae_dy": 0.0850914791226387,
      "pose_rmse_dtheta": 0.37146803736686707,
      "pose_rmse_dx": 0.2955801784992218,
      "pose_rmse_dy": 0.16901083290576935,
      "pose_rmse_mean": 0.2786863446235657,
      "rmse_dtheta": 0.04470186308026314,
      "rmse_dx": 0.029979458078742027,
      "rmse_dy": 0.013795406557619572,
      "rmse_mean": 0.029492242261767387,
      "rotation_flip": 0.0066225165501236916,
      "sparse_tokens": 17018.0,
      "step": 5704,
      "turn_loss": 0.26144373416900635,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.2650529641330608,
      "grad_norm": 0.5890255570411682,
      "learning_rate": 5.470015023531138e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.03433568403124809,
      "mae_dx": 0.009491517208516598,
      "mae_dy": 0.004674323834478855,
      "pose_mae_dtheta": 0.25595107674598694,
      "pose_mae_dx": 0.07391408830881119,
      "pose_mae_dy": 0.059890732169151306,
      "pose_rmse_dtheta": 0.4758692979812622,
      "pose_rmse_dx": 0.15972721576690674,
      "pose_rmse_dy": 0.14560385048389435,
      "pose_rmse_mean": 0.26040011644363403,
      "rmse_dtheta": 0.05402253195643425,
      "rmse_dx": 0.019930927082896233,
      "rmse_dy": 0.009896417148411274,
      "rmse_mean": 0.02794995903968811,
      "rotation_flip": 0.00772626930847764,
      "sparse_tokens": 14562.0,
      "step": 5705,
      "turn_loss": 0.23354887962341309,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.26509942389890356,
      "grad_norm": 0.41645851731300354,
      "learning_rate": 5.468698642882557e-06,
      "loss": 0.0828,
      "mae_dtheta": 0.007168718613684177,
      "mae_dx": 0.0013238223036751151,
      "mae_dy": 0.00125710922293365,
      "pose_mae_dtheta": 0.04889651760458946,
      "pose_mae_dx": 0.016271185129880905,
      "pose_mae_dy": 0.020750394091010094,
      "pose_rmse_dtheta": 0.14507849514484406,
      "pose_rmse_dx": 0.040519829839468,
      "pose_rmse_dy": 0.0697847306728363,
      "pose_rmse_mean": 0.08512769639492035,
      "rmse_dtheta": 0.019782505929470062,
      "rmse_dx": 0.003968029748648405,
      "rmse_dy": 0.003737720660865307,
      "rmse_mean": 0.009162752889096737,
      "rotation_flip": 0.0010070493444800377,
      "sparse_tokens": 32121.0,
      "step": 5706,
      "turn_loss": 0.05673813074827194,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.26514588366474634,
      "grad_norm": 0.3064931631088257,
      "learning_rate": 5.467382229457629e-06,
      "loss": 0.0696,
      "mae_dtheta": 0.008527838625013828,
      "mae_dx": 0.0018897561822086573,
      "mae_dy": 0.0018294695764780045,
      "pose_mae_dtheta": 0.05129305645823479,
      "pose_mae_dx": 0.02211330272257328,
      "pose_mae_dy": 0.022577663883566856,
      "pose_rmse_dtheta": 0.10624587535858154,
      "pose_rmse_dx": 0.052013788372278214,
      "pose_rmse_dy": 0.050275448709726334,
      "pose_rmse_mean": 0.06951170414686203,
      "rmse_dtheta": 0.018521219491958618,
      "rmse_dx": 0.005172728095203638,
      "rmse_dy": 0.003890416817739606,
      "rmse_mean": 0.00919478852301836,
      "rotation_flip": 0.0045045046135783195,
      "sparse_tokens": 32121.0,
      "step": 5707,
      "turn_loss": 0.07785791903734207,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2651923434305891,
      "grad_norm": 0.4685688316822052,
      "learning_rate": 5.466065783348411e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.01198901329189539,
      "mae_dx": 0.0021984654013067484,
      "mae_dy": 0.002477120840921998,
      "pose_mae_dtheta": 0.07841488718986511,
      "pose_mae_dx": 0.024353444576263428,
      "pose_mae_dy": 0.03191769868135452,
      "pose_rmse_dtheta": 0.19444669783115387,
      "pose_rmse_dx": 0.056341320276260376,
      "pose_rmse_dy": 0.0672844648361206,
      "pose_rmse_mean": 0.10602416843175888,
      "rmse_dtheta": 0.02653161995112896,
      "rmse_dx": 0.007133868522942066,
      "rmse_dy": 0.00584750110283494,
      "rmse_mean": 0.013170997612178326,
      "rotation_flip": 0.005231388378888369,
      "sparse_tokens": 32105.0,
      "step": 5708,
      "turn_loss": 0.09721191227436066,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.2652388031964319,
      "grad_norm": 0.39301925897598267,
      "learning_rate": 5.464749304646963e-06,
      "loss": 0.1149,
      "mae_dtheta": 0.049884967505931854,
      "mae_dx": 0.011426817625761032,
      "mae_dy": 0.00501397717744112,
      "pose_mae_dtheta": 0.42771556973457336,
      "pose_mae_dx": 0.09111690521240234,
      "pose_mae_dy": 0.06139036640524864,
      "pose_rmse_dtheta": 0.6812116503715515,
      "pose_rmse_dx": 0.1702435314655304,
      "pose_rmse_dy": 0.15281154215335846,
      "pose_rmse_mean": 0.3347555994987488,
      "rmse_dtheta": 0.06953192502260208,
      "rmse_dx": 0.021913262084126472,
      "rmse_dy": 0.010562931187450886,
      "rmse_mean": 0.03400270640850067,
      "rotation_flip": 0.011138614267110825,
      "sparse_tokens": 12460.0,
      "step": 5709,
      "turn_loss": 0.38460469245910645,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.26528526296227467,
      "grad_norm": 0.4094363749027252,
      "learning_rate": 5.4634327934453444e-06,
      "loss": 0.1286,
      "mae_dtheta": 0.03480570763349533,
      "mae_dx": 0.012477369047701359,
      "mae_dy": 0.003728204406797886,
      "pose_mae_dtheta": 0.2879851758480072,
      "pose_mae_dx": 0.10719659924507141,
      "pose_mae_dy": 0.053076911717653275,
      "pose_rmse_dtheta": 0.5032129287719727,
      "pose_rmse_dx": 0.23474346101284027,
      "pose_rmse_dy": 0.11560129374265671,
      "pose_rmse_mean": 0.2845192551612854,
      "rmse_dtheta": 0.052623406052589417,
      "rmse_dx": 0.025469347834587097,
      "rmse_dy": 0.007162389811128378,
      "rmse_mean": 0.02841838262975216,
      "rotation_flip": 0.017331022769212723,
      "sparse_tokens": 20118.0,
      "step": 5710,
      "turn_loss": 0.27177751064300537,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.26533172272811745,
      "grad_norm": 0.7149446606636047,
      "learning_rate": 5.462116249835624e-06,
      "loss": 0.1339,
      "mae_dtheta": 0.03966338187456131,
      "mae_dx": 0.00930232834070921,
      "mae_dy": 0.007306243292987347,
      "pose_mae_dtheta": 0.3424401879310608,
      "pose_mae_dx": 0.05207781493663788,
      "pose_mae_dy": 0.06273079663515091,
      "pose_rmse_dtheta": 0.5897899270057678,
      "pose_rmse_dx": 0.10050936788320541,
      "pose_rmse_dy": 0.18955181539058685,
      "pose_rmse_mean": 0.29328370094299316,
      "rmse_dtheta": 0.06067369505763054,
      "rmse_dx": 0.018239574506878853,
      "rmse_dy": 0.018140316009521484,
      "rmse_mean": 0.03235119581222534,
      "rotation_flip": 0.013201320543885231,
      "sparse_tokens": 10279.0,
      "step": 5711,
      "turn_loss": 0.34865596890449524,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2653781824939602,
      "grad_norm": 0.5467141270637512,
      "learning_rate": 5.460799673909865e-06,
      "loss": 0.1364,
      "mae_dtheta": 0.01245279423892498,
      "mae_dx": 0.0013506357790902257,
      "mae_dy": 0.0019746203906834126,
      "pose_mae_dtheta": 0.08764198422431946,
      "pose_mae_dx": 0.02052142657339573,
      "pose_mae_dy": 0.028354573994874954,
      "pose_rmse_dtheta": 0.24822846055030823,
      "pose_rmse_dx": 0.05397482216358185,
      "pose_rmse_dy": 0.0826738253235817,
      "pose_rmse_mean": 0.12829238176345825,
      "rmse_dtheta": 0.028566474094986916,
      "rmse_dx": 0.004251634236425161,
      "rmse_dy": 0.004474211018532515,
      "rmse_mean": 0.012430774047970772,
      "rotation_flip": 0.0007704160525463521,
      "sparse_tokens": 32121.0,
      "step": 5712,
      "turn_loss": 0.08957896381616592,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.265424642259803,
      "grad_norm": 0.8863291144371033,
      "learning_rate": 5.459483065760138e-06,
      "loss": 0.177,
      "mae_dtheta": 0.033218659460544586,
      "mae_dx": 0.012140545062720776,
      "mae_dy": 0.0052823335863649845,
      "pose_mae_dtheta": 0.2433905005455017,
      "pose_mae_dx": 0.09188401699066162,
      "pose_mae_dy": 0.05571706220507622,
      "pose_rmse_dtheta": 0.44165822863578796,
      "pose_rmse_dx": 0.2143303006887436,
      "pose_rmse_dy": 0.11004775017499924,
      "pose_rmse_mean": 0.2553454339504242,
      "rmse_dtheta": 0.048457562923431396,
      "rmse_dx": 0.024603692814707756,
      "rmse_dy": 0.010210378095507622,
      "rmse_mean": 0.02775721251964569,
      "rotation_flip": 0.020134227350354195,
      "sparse_tokens": 9998.0,
      "step": 5713,
      "turn_loss": 0.33257365226745605,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.2654711020256458,
      "grad_norm": 1.2402220964431763,
      "learning_rate": 5.458166425478514e-06,
      "loss": 0.2815,
      "mae_dtheta": 0.036312539130449295,
      "mae_dx": 0.008024254813790321,
      "mae_dy": 0.006344635505229235,
      "pose_mae_dtheta": 0.281510591506958,
      "pose_mae_dx": 0.0760396420955658,
      "pose_mae_dy": 0.09637608379125595,
      "pose_rmse_dtheta": 0.4558817744255066,
      "pose_rmse_dx": 0.1753903478384018,
      "pose_rmse_dy": 0.20444488525390625,
      "pose_rmse_mean": 0.27857235074043274,
      "rmse_dtheta": 0.05611060932278633,
      "rmse_dx": 0.019187171012163162,
      "rmse_dy": 0.011500466614961624,
      "rmse_mean": 0.02893275022506714,
      "rotation_flip": 0.01875000074505806,
      "sparse_tokens": 5507.0,
      "step": 5714,
      "turn_loss": 0.2152339667081833,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.26551756179148855,
      "grad_norm": 0.4365992248058319,
      "learning_rate": 5.456849753157065e-06,
      "loss": 0.0695,
      "mae_dtheta": 0.00667902547866106,
      "mae_dx": 0.0013271775096654892,
      "mae_dy": 0.0013560347724705935,
      "pose_mae_dtheta": 0.04965326189994812,
      "pose_mae_dx": 0.015037068165838718,
      "pose_mae_dy": 0.017736470326781273,
      "pose_rmse_dtheta": 0.15101422369480133,
      "pose_rmse_dx": 0.03804356977343559,
      "pose_rmse_dy": 0.04630156233906746,
      "pose_rmse_mean": 0.07845312356948853,
      "rmse_dtheta": 0.018762929365038872,
      "rmse_dx": 0.003863180987536907,
      "rmse_dy": 0.0028787609189748764,
      "rmse_mean": 0.008501623757183552,
      "rotation_flip": 0.003270645858719945,
      "sparse_tokens": 32201.0,
      "step": 5715,
      "turn_loss": 0.05069850757718086,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.26556402155733133,
      "grad_norm": 0.519282877445221,
      "learning_rate": 5.455533048887868e-06,
      "loss": 0.1765,
      "mae_dtheta": 0.009807150810956955,
      "mae_dx": 0.002202632836997509,
      "mae_dy": 0.002233813051134348,
      "pose_mae_dtheta": 0.06532660871744156,
      "pose_mae_dx": 0.02372453548014164,
      "pose_mae_dy": 0.028351640328764915,
      "pose_rmse_dtheta": 0.14568813145160675,
      "pose_rmse_dx": 0.07562423497438431,
      "pose_rmse_dy": 0.07013855874538422,
      "pose_rmse_mean": 0.09715031087398529,
      "rmse_dtheta": 0.02140125073492527,
      "rmse_dx": 0.008473646827042103,
      "rmse_dy": 0.005959062837064266,
      "rmse_mean": 0.011944654397666454,
      "rotation_flip": 0.00400962308049202,
      "sparse_tokens": 32089.0,
      "step": 5716,
      "turn_loss": 0.09758821874856949,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3594.0,
      "epoch": 0.2656104813231741,
      "grad_norm": 0.5840688347816467,
      "learning_rate": 5.454216312763001e-06,
      "loss": 0.1244,
      "mae_dtheta": 0.029150595888495445,
      "mae_dx": 0.005306372418999672,
      "mae_dy": 0.006796013098210096,
      "pose_mae_dtheta": 0.2658017873764038,
      "pose_mae_dx": 0.05031006410717964,
      "pose_mae_dy": 0.08573024719953537,
      "pose_rmse_dtheta": 0.4254996180534363,
      "pose_rmse_dx": 0.10224822163581848,
      "pose_rmse_dy": 0.21459005773067474,
      "pose_rmse_mean": 0.2474459856748581,
      "rmse_dtheta": 0.0426383838057518,
      "rmse_dx": 0.0130071472376585,
      "rmse_dy": 0.012374461628496647,
      "rmse_mean": 0.022673331201076508,
      "rotation_flip": 0.0357142873108387,
      "sparse_tokens": 3083.0,
      "step": 5717,
      "turn_loss": 0.24010108411312103,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 13649.0,
      "epoch": 0.2656569410890169,
      "grad_norm": 0.48019322752952576,
      "learning_rate": 5.452899544874543e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.04050209000706673,
      "mae_dx": 0.014343595132231712,
      "mae_dy": 0.004733936861157417,
      "pose_mae_dtheta": 0.2949533760547638,
      "pose_mae_dx": 0.11046088486909866,
      "pose_mae_dy": 0.05097818747162819,
      "pose_rmse_dtheta": 0.4405677616596222,
      "pose_rmse_dx": 0.22529226541519165,
      "pose_rmse_dy": 0.1177394688129425,
      "pose_rmse_mean": 0.26119983196258545,
      "rmse_dtheta": 0.05566202849149704,
      "rmse_dx": 0.026695381850004196,
      "rmse_dy": 0.010062487795948982,
      "rmse_mean": 0.030806630849838257,
      "rotation_flip": 0.012413793243467808,
      "sparse_tokens": 10097.0,
      "step": 5718,
      "turn_loss": 0.3015824854373932,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2657034008548597,
      "grad_norm": 0.41427624225616455,
      "learning_rate": 5.451582745314576e-06,
      "loss": 0.1286,
      "mae_dtheta": 0.007146486081182957,
      "mae_dx": 0.0016937574837356806,
      "mae_dy": 0.001585742342285812,
      "pose_mae_dtheta": 0.0484875850379467,
      "pose_mae_dx": 0.017567913979291916,
      "pose_mae_dy": 0.01792258396744728,
      "pose_rmse_dtheta": 0.14706891775131226,
      "pose_rmse_dx": 0.04903490096330643,
      "pose_rmse_dy": 0.04343826696276665,
      "pose_rmse_mean": 0.07984736561775208,
      "rmse_dtheta": 0.01811358332633972,
      "rmse_dx": 0.005509904585778713,
      "rmse_dy": 0.0036819991655647755,
      "rmse_mean": 0.00910182949155569,
      "rotation_flip": 0.006345848552882671,
      "sparse_tokens": 32105.0,
      "step": 5719,
      "turn_loss": 0.060831084847450256,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28464.0,
      "epoch": 0.2657498606207025,
      "grad_norm": 0.606328010559082,
      "learning_rate": 5.450265914175187e-06,
      "loss": 0.167,
      "mae_dtheta": 0.037010058760643005,
      "mae_dx": 0.013875649310648441,
      "mae_dy": 0.007070574909448624,
      "pose_mae_dtheta": 0.2982434332370758,
      "pose_mae_dx": 0.10689600557088852,
      "pose_mae_dy": 0.09387334436178207,
      "pose_rmse_dtheta": 0.5044112205505371,
      "pose_rmse_dx": 0.2198227196931839,
      "pose_rmse_dy": 0.2361939251422882,
      "pose_rmse_mean": 0.32014262676239014,
      "rmse_dtheta": 0.05486869439482689,
      "rmse_dx": 0.02612755447626114,
      "rmse_dy": 0.014234268106520176,
      "rmse_mean": 0.031743504106998444,
      "rotation_flip": 0.016332590952515602,
      "sparse_tokens": 22234.0,
      "step": 5720,
      "turn_loss": 0.2959108054637909,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.26579632038654527,
      "grad_norm": 0.7911337018013,
      "learning_rate": 5.448949051548459e-06,
      "loss": 0.1812,
      "mae_dtheta": 0.02999039553105831,
      "mae_dx": 0.010166632942855358,
      "mae_dy": 0.008104187436401844,
      "pose_mae_dtheta": 0.20761039853096008,
      "pose_mae_dx": 0.08418061584234238,
      "pose_mae_dy": 0.10926767438650131,
      "pose_rmse_dtheta": 0.38950490951538086,
      "pose_rmse_dx": 0.1860995888710022,
      "pose_rmse_dy": 0.26792293787002563,
      "pose_rmse_mean": 0.281175822019577,
      "rmse_dtheta": 0.04524082690477371,
      "rmse_dx": 0.022700529545545578,
      "rmse_dy": 0.015875445678830147,
      "rmse_mean": 0.027938932180404663,
      "rotation_flip": 0.012362637557089329,
      "sparse_tokens": 13458.0,
      "step": 5721,
      "turn_loss": 0.2380274087190628,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.26584278015238805,
      "grad_norm": 0.5840506553649902,
      "learning_rate": 5.447632157526483e-06,
      "loss": 0.1602,
      "mae_dtheta": 0.03728463128209114,
      "mae_dx": 0.00950372964143753,
      "mae_dy": 0.004965841770172119,
      "pose_mae_dtheta": 0.27860915660858154,
      "pose_mae_dx": 0.06832586228847504,
      "pose_mae_dy": 0.06767648458480835,
      "pose_rmse_dtheta": 0.5170745849609375,
      "pose_rmse_dx": 0.17192038893699646,
      "pose_rmse_dy": 0.13346122205257416,
      "pose_rmse_mean": 0.27415210008621216,
      "rmse_dtheta": 0.05452745035290718,
      "rmse_dx": 0.02082853578031063,
      "rmse_dy": 0.008195286616683006,
      "rmse_mean": 0.027850424870848656,
      "rotation_flip": 0.02923976629972458,
      "sparse_tokens": 5436.0,
      "step": 5722,
      "turn_loss": 0.2559550702571869,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2658892399182308,
      "grad_norm": 0.4951450824737549,
      "learning_rate": 5.446315232201352e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.00970944482833147,
      "mae_dx": 0.0011728708632290363,
      "mae_dy": 0.002209816826507449,
      "pose_mae_dtheta": 0.06460738927125931,
      "pose_mae_dx": 0.017455214634537697,
      "pose_mae_dy": 0.029882770031690598,
      "pose_rmse_dtheta": 0.13047876954078674,
      "pose_rmse_dx": 0.051638513803482056,
      "pose_rmse_dy": 0.06732655316591263,
      "pose_rmse_mean": 0.08314794301986694,
      "rmse_dtheta": 0.019457655027508736,
      "rmse_dx": 0.003387054428458214,
      "rmse_dy": 0.005127334501594305,
      "rmse_mean": 0.009324015118181705,
      "rotation_flip": 0.007819287478923798,
      "sparse_tokens": 32057.0,
      "step": 5723,
      "turn_loss": 0.08126738667488098,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2659356996840736,
      "grad_norm": 0.4212184548377991,
      "learning_rate": 5.444998275665156e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.010407914407551289,
      "mae_dx": 0.0022467654198408127,
      "mae_dy": 0.0022402808535844088,
      "pose_mae_dtheta": 0.07650760561227798,
      "pose_mae_dx": 0.024086298421025276,
      "pose_mae_dy": 0.021971622481942177,
      "pose_rmse_dtheta": 0.2135583907365799,
      "pose_rmse_dx": 0.07600720971822739,
      "pose_rmse_dy": 0.050442006438970566,
      "pose_rmse_mean": 0.11333587020635605,
      "rmse_dtheta": 0.025661282241344452,
      "rmse_dx": 0.006788767408579588,
      "rmse_dy": 0.007036649622023106,
      "rmse_mean": 0.01316223293542862,
      "rotation_flip": 0.006573181599378586,
      "sparse_tokens": 32121.0,
      "step": 5724,
      "turn_loss": 0.08320917934179306,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2659821594499164,
      "grad_norm": 0.3826291859149933,
      "learning_rate": 5.443681288009991e-06,
      "loss": 0.0798,
      "mae_dtheta": 0.013613111339509487,
      "mae_dx": 0.0027928161434829235,
      "mae_dy": 0.003735034493729472,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3826291561126709,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.60169982910156,
      "model/head/act_norm_mean": 107.86947601010101,
      "model/head/act_norm_min": 50.076202392578125,
      "model/head/act_over_embed": 74.12891380408689,
      "model/head/grad_frac": 0.10444237291812897,
      "model/head/grad_norm": 0.03996269777417183,
      "model/head/grad_zero_frac": 0.00017989308980759233,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7018919665404041,
      "model/head/update_ratio": 0.0006832067738287151,
      "model/head/weight_delta": 8.77088451385498,
      "model/head/weight_delta_rel": 0.15386728942394257,
      "model/head/weight_norm": 58.49283218383789,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42081207036972046,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4207585192373975,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42069211602211,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2891491936232598,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09867515414953232,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03775599226355553,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5166236566742082,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012205851962789893,
      "model/modality_embedder.encoders.pose/weight_delta": 2.863521099090576,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09356015920639038,
      "model/modality_embedder.encoders.pose/weight_norm": 30.932697296142578,
      "model/modality_embedder/grad_frac": 0.09867515414953232,
      "model/modality_embedder/grad_norm": 0.03775599226355553,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5166236566742082,
      "model/modality_embedder/update_ratio": 0.0012205851962789893,
      "model/modality_embedder/weight_delta": 2.863521099090576,
      "model/modality_embedder/weight_delta_rel": 0.09356015920639038,
      "model/modality_embedder/weight_norm": 30.932697296142578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.0282211303711,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.44462481962482,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.063231468200684,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.11136566808189,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08975311368703842,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03434215858578682,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001233256421983242,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.214130401611328,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08068424463272095,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.846731185913086,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.3257064819336,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.43249458874459,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.348215103149414,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.79023902200349,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07947385311126709,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030409013852477074,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010279498528689146,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.8059275150299072,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09719952195882797,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.582197189331055,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.76190948486328,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.342933301266633,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.65015983581543,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.10311039105766,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08373726904392242,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.032040320336818695,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010490580461919308,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.024496555328369,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1015569344162941,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.541990280151367,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.51538848876953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.228863536155202,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.476750373840332,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.399139304830125,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10388331860303879,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03974878787994385,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013336146948859096,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.582764148712158,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08826661854982376,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.805301666259766,
      "model/normalizer/grad_frac": 0.4827498495578766,
      "model/normalizer/grad_norm": 0.1847141683101654,
      "model/normalizer/grad_zero_frac": 0.00017253380792681128,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002354640746489167,
      "model/normalizer/weight_delta": 5.472172737121582,
      "model/normalizer/weight_delta_rel": 0.0704784169793129,
      "model/normalizer/weight_norm": 78.44686126708984,
      "pose_mae_dtheta": 0.09359966218471527,
      "pose_mae_dx": 0.03482579439878464,
      "pose_mae_dy": 0.03769483044743538,
      "pose_rmse_dtheta": 0.22626885771751404,
      "pose_rmse_dx": 0.09225501865148544,
      "pose_rmse_dy": 0.08833620697259903,
      "pose_rmse_mean": 0.13562002778053284,
      "rmse_dtheta": 0.028313230723142624,
      "rmse_dx": 0.007072535343468189,
      "rmse_dy": 0.008118849247694016,
      "rmse_mean": 0.014501538127660751,
      "rotation_flip": 0.0039725531823933125,
      "sparse_tokens": 32089.0,
      "step": 5725,
      "turn_loss": 0.1358027160167694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.26602861921575915,
      "grad_norm": 0.8341802358627319,
      "learning_rate": 5.4423642693279556e-06,
      "loss": 0.173,
      "mae_dtheta": 0.025364361703395844,
      "mae_dx": 0.009493100456893444,
      "mae_dy": 0.008136814460158348,
      "pose_mae_dtheta": 0.1910080462694168,
      "pose_mae_dx": 0.06873590499162674,
      "pose_mae_dy": 0.08844638615846634,
      "pose_rmse_dtheta": 0.3601335287094116,
      "pose_rmse_dx": 0.1485460102558136,
      "pose_rmse_dy": 0.2206394076347351,
      "pose_rmse_mean": 0.24310630559921265,
      "rmse_dtheta": 0.04259267449378967,
      "rmse_dx": 0.019363906234502792,
      "rmse_dy": 0.018077289685606956,
      "rmse_mean": 0.02667795680463314,
      "rotation_flip": 0.014767932705581188,
      "sparse_tokens": 8814.0,
      "step": 5726,
      "turn_loss": 0.28272467851638794,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.26607507898160193,
      "grad_norm": 0.7103039622306824,
      "learning_rate": 5.441047219711151e-06,
      "loss": 0.3023,
      "mae_dtheta": 0.037557486444711685,
      "mae_dx": 0.011098631657660007,
      "mae_dy": 0.004079548176378012,
      "pose_mae_dtheta": 0.30012959241867065,
      "pose_mae_dx": 0.08427386730909348,
      "pose_mae_dy": 0.058680616319179535,
      "pose_rmse_dtheta": 0.5217607021331787,
      "pose_rmse_dx": 0.20233234763145447,
      "pose_rmse_dy": 0.13955749571323395,
      "pose_rmse_mean": 0.2878835201263428,
      "rmse_dtheta": 0.05620773881673813,
      "rmse_dx": 0.022856710478663445,
      "rmse_dy": 0.00800972618162632,
      "rmse_mean": 0.029024725779891014,
      "rotation_flip": 0.011041009798645973,
      "sparse_tokens": 23445.0,
      "step": 5727,
      "turn_loss": 0.255060076713562,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2661215387474447,
      "grad_norm": 0.48099789023399353,
      "learning_rate": 5.4397301392516755e-06,
      "loss": 0.1429,
      "mae_dtheta": 0.009799675084650517,
      "mae_dx": 0.002592582255601883,
      "mae_dy": 0.0031351372599601746,
      "pose_mae_dtheta": 0.06698235124349594,
      "pose_mae_dx": 0.03346174582839012,
      "pose_mae_dy": 0.02862968109548092,
      "pose_rmse_dtheta": 0.16499526798725128,
      "pose_rmse_dx": 0.09423298388719559,
      "pose_rmse_dy": 0.06903217732906342,
      "pose_rmse_mean": 0.10942014306783676,
      "rmse_dtheta": 0.021624736487865448,
      "rmse_dx": 0.007148317527025938,
      "rmse_dy": 0.007201405707746744,
      "rmse_mean": 0.011991487815976143,
      "rotation_flip": 0.0018968133954331279,
      "sparse_tokens": 32089.0,
      "step": 5728,
      "turn_loss": 0.08938930183649063,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2661679985132875,
      "grad_norm": 0.5056489706039429,
      "learning_rate": 5.438413028041637e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.011898322030901909,
      "mae_dx": 0.002138016512617469,
      "mae_dy": 0.002869828138500452,
      "pose_mae_dtheta": 0.08683301508426666,
      "pose_mae_dx": 0.029471222311258316,
      "pose_mae_dy": 0.03300803527235985,
      "pose_rmse_dtheta": 0.2110234946012497,
      "pose_rmse_dx": 0.08223690092563629,
      "pose_rmse_dy": 0.08745553344488144,
      "pose_rmse_mean": 0.12690532207489014,
      "rmse_dtheta": 0.02623380348086357,
      "rmse_dx": 0.005658913403749466,
      "rmse_dy": 0.007685079704970121,
      "rmse_mean": 0.013192599639296532,
      "rotation_flip": 0.0072289155796170235,
      "sparse_tokens": 32153.0,
      "step": 5729,
      "turn_loss": 0.11164188385009766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.26621445827913026,
      "grad_norm": 0.5596282482147217,
      "learning_rate": 5.437095886173139e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.009619479067623615,
      "mae_dx": 0.0022604207042604685,
      "mae_dy": 0.0027697482146322727,
      "pose_mae_dtheta": 0.06643649935722351,
      "pose_mae_dx": 0.024945637211203575,
      "pose_mae_dy": 0.022269492968916893,
      "pose_rmse_dtheta": 0.1836845427751541,
      "pose_rmse_dx": 0.07641426473855972,
      "pose_rmse_dy": 0.059660546481609344,
      "pose_rmse_mean": 0.10658645629882812,
      "rmse_dtheta": 0.023395778611302376,
      "rmse_dx": 0.006021108012646437,
      "rmse_dy": 0.007752799894660711,
      "rmse_mean": 0.01238989643752575,
      "rotation_flip": 0.005319148767739534,
      "sparse_tokens": 32185.0,
      "step": 5730,
      "turn_loss": 0.08413328230381012,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.26626091804497304,
      "grad_norm": 0.6435697674751282,
      "learning_rate": 5.435778713738292e-06,
      "loss": 0.1465,
      "mae_dtheta": 0.012340206652879715,
      "mae_dx": 0.001631540828384459,
      "mae_dy": 0.0031560445204377174,
      "pose_mae_dtheta": 0.08668851852416992,
      "pose_mae_dx": 0.027051998302340508,
      "pose_mae_dy": 0.041272494941949844,
      "pose_rmse_dtheta": 0.2081325650215149,
      "pose_rmse_dx": 0.06946315616369247,
      "pose_rmse_dy": 0.12076010555028915,
      "pose_rmse_mean": 0.13278529047966003,
      "rmse_dtheta": 0.025000974535942078,
      "rmse_dx": 0.004625814035534859,
      "rmse_dy": 0.007011361885815859,
      "rmse_mean": 0.012212717905640602,
      "rotation_flip": 0.006841915659606457,
      "sparse_tokens": 32073.0,
      "step": 5731,
      "turn_loss": 0.09125149995088577,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2663073778108158,
      "grad_norm": 0.43262243270874023,
      "learning_rate": 5.434461510829205e-06,
      "loss": 0.0792,
      "mae_dtheta": 0.010357916355133057,
      "mae_dx": 0.0017936344956979156,
      "mae_dy": 0.002049422590062022,
      "pose_mae_dtheta": 0.06844531744718552,
      "pose_mae_dx": 0.02083512954413891,
      "pose_mae_dy": 0.024697724729776382,
      "pose_rmse_dtheta": 0.1644936501979828,
      "pose_rmse_dx": 0.04655321314930916,
      "pose_rmse_dy": 0.05204806849360466,
      "pose_rmse_mean": 0.0876983106136322,
      "rmse_dtheta": 0.023542242124676704,
      "rmse_dx": 0.005227365531027317,
      "rmse_dy": 0.004088565241545439,
      "rmse_mean": 0.010952725075185299,
      "rotation_flip": 0.0018761726096272469,
      "sparse_tokens": 32137.0,
      "step": 5732,
      "turn_loss": 0.08746962249279022,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35255.0,
      "epoch": 0.2663538375766586,
      "grad_norm": 0.7899264097213745,
      "learning_rate": 5.4331442775379906e-06,
      "loss": 0.2433,
      "mae_dtheta": 0.040010884404182434,
      "mae_dx": 0.013953806832432747,
      "mae_dy": 0.004987149499356747,
      "pose_mae_dtheta": 0.3369501829147339,
      "pose_mae_dx": 0.1076689139008522,
      "pose_mae_dy": 0.06583070009946823,
      "pose_rmse_dtheta": 0.5676000118255615,
      "pose_rmse_dx": 0.2439967393875122,
      "pose_rmse_dy": 0.16771075129508972,
      "pose_rmse_mean": 0.3264358639717102,
      "rmse_dtheta": 0.05877985060214996,
      "rmse_dx": 0.02744726650416851,
      "rmse_dy": 0.010505203157663345,
      "rmse_mean": 0.032244108617305756,
      "rotation_flip": 0.014102564193308353,
      "sparse_tokens": 26402.0,
      "step": 5733,
      "turn_loss": 0.31027892231941223,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.26640029734250137,
      "grad_norm": 0.537747859954834,
      "learning_rate": 5.431827013956767e-06,
      "loss": 0.1341,
      "mae_dtheta": 0.03491196036338806,
      "mae_dx": 0.009831278584897518,
      "mae_dy": 0.007233628071844578,
      "pose_mae_dtheta": 0.2586609125137329,
      "pose_mae_dx": 0.08259683102369308,
      "pose_mae_dy": 0.07398835569620132,
      "pose_rmse_dtheta": 0.45598646998405457,
      "pose_rmse_dx": 0.18376386165618896,
      "pose_rmse_dy": 0.15673081576824188,
      "pose_rmse_mean": 0.2654937505722046,
      "rmse_dtheta": 0.05162433162331581,
      "rmse_dx": 0.020570101216435432,
      "rmse_dy": 0.01250496320426464,
      "rmse_mean": 0.028233133256435394,
      "rotation_flip": 0.014005602337419987,
      "sparse_tokens": 5138.0,
      "step": 5734,
      "turn_loss": 0.27553683519363403,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2664467571083442,
      "grad_norm": 0.3861038088798523,
      "learning_rate": 5.430509720177646e-06,
      "loss": 0.1191,
      "mae_dtheta": 0.011440099216997623,
      "mae_dx": 0.0025787234771996737,
      "mae_dy": 0.0037870416417717934,
      "pose_mae_dtheta": 0.07818522304296494,
      "pose_mae_dx": 0.03606300428509712,
      "pose_mae_dy": 0.036527905613183975,
      "pose_rmse_dtheta": 0.20317476987838745,
      "pose_rmse_dx": 0.1052231714129448,
      "pose_rmse_dy": 0.09165523201227188,
      "pose_rmse_mean": 0.13335105776786804,
      "rmse_dtheta": 0.025415955111384392,
      "rmse_dx": 0.00689491955563426,
      "rmse_dy": 0.009495838545262814,
      "rmse_mean": 0.013935571536421776,
      "rotation_flip": 0.0038743005134165287,
      "sparse_tokens": 32089.0,
      "step": 5735,
      "turn_loss": 0.11405264586210251,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.266493216874187,
      "grad_norm": 0.5578320026397705,
      "learning_rate": 5.42919239629275e-06,
      "loss": 0.1243,
      "mae_dtheta": 0.009645490907132626,
      "mae_dx": 0.0013522403314709663,
      "mae_dy": 0.0017475795466452837,
      "pose_mae_dtheta": 0.06469065696001053,
      "pose_mae_dx": 0.01678142324090004,
      "pose_mae_dy": 0.023988451808691025,
      "pose_rmse_dtheta": 0.15526211261749268,
      "pose_rmse_dx": 0.05075546354055405,
      "pose_rmse_dy": 0.06112099066376686,
      "pose_rmse_mean": 0.08904619514942169,
      "rmse_dtheta": 0.019880477339029312,
      "rmse_dx": 0.004941108636558056,
      "rmse_dy": 0.00424033310264349,
      "rmse_mean": 0.00968730729073286,
      "rotation_flip": 0.002753737149760127,
      "sparse_tokens": 32105.0,
      "step": 5736,
      "turn_loss": 0.07858039438724518,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.26653967664002975,
      "grad_norm": 0.501726508140564,
      "learning_rate": 5.4278750423942e-06,
      "loss": 0.1417,
      "mae_dtheta": 0.012225032784044743,
      "mae_dx": 0.0018328853184357285,
      "mae_dy": 0.0029704724438488483,
      "pose_mae_dtheta": 0.08745760470628738,
      "pose_mae_dx": 0.028095779940485954,
      "pose_mae_dy": 0.037298526614904404,
      "pose_rmse_dtheta": 0.21707002818584442,
      "pose_rmse_dx": 0.07685507833957672,
      "pose_rmse_dy": 0.09827052801847458,
      "pose_rmse_mean": 0.13073188066482544,
      "rmse_dtheta": 0.024622062221169472,
      "rmse_dx": 0.005280944984406233,
      "rmse_dy": 0.006669951602816582,
      "rmse_mean": 0.012190986424684525,
      "rotation_flip": 0.005656108725816011,
      "sparse_tokens": 32073.0,
      "step": 5737,
      "turn_loss": 0.0885707214474678,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.26658613640587253,
      "grad_norm": 0.646159827709198,
      "learning_rate": 5.4265576585741174e-06,
      "loss": 0.2696,
      "mae_dtheta": 0.037771787494421005,
      "mae_dx": 0.019110102206468582,
      "mae_dy": 0.008479789830744267,
      "pose_mae_dtheta": 0.3001144230365753,
      "pose_mae_dx": 0.12992343306541443,
      "pose_mae_dy": 0.11193407326936722,
      "pose_rmse_dtheta": 0.465190589427948,
      "pose_rmse_dx": 0.2282993346452713,
      "pose_rmse_dy": 0.27945053577423096,
      "pose_rmse_mean": 0.3243134915828705,
      "rmse_dtheta": 0.05190719664096832,
      "rmse_dx": 0.03104904294013977,
      "rmse_dy": 0.016897236928343773,
      "rmse_mean": 0.033284492790699005,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 2923.0,
      "step": 5738,
      "turn_loss": 0.4018135964870453,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2666325961717153,
      "grad_norm": 0.5016701221466064,
      "learning_rate": 5.42524024492463e-06,
      "loss": 0.133,
      "mae_dtheta": 0.011905799619853497,
      "mae_dx": 0.0016883298521861434,
      "mae_dy": 0.001703221001662314,
      "pose_mae_dtheta": 0.08205430209636688,
      "pose_mae_dx": 0.01651849038898945,
      "pose_mae_dy": 0.022537462413311005,
      "pose_rmse_dtheta": 0.22494108974933624,
      "pose_rmse_dx": 0.03871431201696396,
      "pose_rmse_dy": 0.0517282709479332,
      "pose_rmse_mean": 0.10512789338827133,
      "rmse_dtheta": 0.025683004409074783,
      "rmse_dx": 0.0054641892202198505,
      "rmse_dy": 0.0032024942338466644,
      "rmse_mean": 0.011449895799160004,
      "rotation_flip": 0.005897219758480787,
      "sparse_tokens": 32105.0,
      "step": 5739,
      "turn_loss": 0.07849692553281784,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2666790559375581,
      "grad_norm": 0.7354666590690613,
      "learning_rate": 5.423922801537862e-06,
      "loss": 0.1522,
      "mae_dtheta": 0.010790420696139336,
      "mae_dx": 0.0018041045404970646,
      "mae_dy": 0.002635585144162178,
      "pose_mae_dtheta": 0.07003381848335266,
      "pose_mae_dx": 0.025957932695746422,
      "pose_mae_dy": 0.029322326183319092,
      "pose_rmse_dtheta": 0.17589449882507324,
      "pose_rmse_dx": 0.0630960687994957,
      "pose_rmse_dy": 0.0766587108373642,
      "pose_rmse_mean": 0.10521642863750458,
      "rmse_dtheta": 0.024244990199804306,
      "rmse_dx": 0.004440036602318287,
      "rmse_dy": 0.005847414955496788,
      "rmse_mean": 0.011510814540088177,
      "rotation_flip": 0.0058202981017529964,
      "sparse_tokens": 32153.0,
      "step": 5740,
      "turn_loss": 0.09691518545150757,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.26672551570340086,
      "grad_norm": 0.5010770559310913,
      "learning_rate": 5.4226053285059466e-06,
      "loss": 0.1324,
      "mae_dtheta": 0.02968338131904602,
      "mae_dx": 0.007450319826602936,
      "mae_dy": 0.0041956729255616665,
      "pose_mae_dtheta": 0.2191997468471527,
      "pose_mae_dx": 0.05777579918503761,
      "pose_mae_dy": 0.04702022299170494,
      "pose_rmse_dtheta": 0.40424811840057373,
      "pose_rmse_dx": 0.13016094267368317,
      "pose_rmse_dy": 0.10419368743896484,
      "pose_rmse_mean": 0.2128675878047943,
      "rmse_dtheta": 0.048420678824186325,
      "rmse_dx": 0.017034634947776794,
      "rmse_dy": 0.007905563339591026,
      "rmse_mean": 0.024453628808259964,
      "rotation_flip": 0.010723860934376717,
      "sparse_tokens": 6504.0,
      "step": 5741,
      "turn_loss": 0.16987912356853485,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.26677197546924364,
      "grad_norm": 0.5114219188690186,
      "learning_rate": 5.421287825921015e-06,
      "loss": 0.1837,
      "mae_dtheta": 0.009728463366627693,
      "mae_dx": 0.001804515952244401,
      "mae_dy": 0.002312256256118417,
      "pose_mae_dtheta": 0.0650273859500885,
      "pose_mae_dx": 0.019200468435883522,
      "pose_mae_dy": 0.026173114776611328,
      "pose_rmse_dtheta": 0.1413653939962387,
      "pose_rmse_dx": 0.0520855076611042,
      "pose_rmse_dy": 0.05725453421473503,
      "pose_rmse_mean": 0.08356847614049911,
      "rmse_dtheta": 0.020052725449204445,
      "rmse_dx": 0.005881144665181637,
      "rmse_dy": 0.004967016167938709,
      "rmse_mean": 0.010300295427441597,
      "rotation_flip": 0.00491918483749032,
      "sparse_tokens": 32121.0,
      "step": 5742,
      "turn_loss": 0.07801339775323868,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2668184352350864,
      "grad_norm": 0.4885460436344147,
      "learning_rate": 5.419970293875197e-06,
      "loss": 0.0846,
      "mae_dtheta": 0.0058831418864429,
      "mae_dx": 0.0009957327274605632,
      "mae_dy": 0.0004029835981782526,
      "pose_mae_dtheta": 0.04512717202305794,
      "pose_mae_dx": 0.0086023835465312,
      "pose_mae_dy": 0.00672045536339283,
      "pose_rmse_dtheta": 0.2193051427602768,
      "pose_rmse_dx": 0.02225656621158123,
      "pose_rmse_dy": 0.020382048562169075,
      "pose_rmse_mean": 0.08731459081172943,
      "rmse_dtheta": 0.023642193526029587,
      "rmse_dx": 0.003279263386502862,
      "rmse_dy": 0.0009248122223652899,
      "rmse_mean": 0.00928208976984024,
      "rotation_flip": 0.0007616146467626095,
      "sparse_tokens": 32121.0,
      "step": 5743,
      "turn_loss": 0.03713022917509079,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.2668648950009292,
      "grad_norm": 0.6268449425697327,
      "learning_rate": 5.418652732460633e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.03386275842785835,
      "mae_dx": 0.009233408607542515,
      "mae_dy": 0.0031617849599570036,
      "pose_mae_dtheta": 0.28534001111984253,
      "pose_mae_dx": 0.07898131757974625,
      "pose_mae_dy": 0.024455972015857697,
      "pose_rmse_dtheta": 0.5085750818252563,
      "pose_rmse_dx": 0.17413440346717834,
      "pose_rmse_dy": 0.05461931973695755,
      "pose_rmse_mean": 0.24577626585960388,
      "rmse_dtheta": 0.05292839929461479,
      "rmse_dx": 0.019736504182219505,
      "rmse_dy": 0.007348855957388878,
      "rmse_mean": 0.02667125314474106,
      "rotation_flip": 0.01867816038429737,
      "sparse_tokens": 10355.0,
      "step": 5744,
      "turn_loss": 0.2380998283624649,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.26691135476677197,
      "grad_norm": 0.571209728717804,
      "learning_rate": 5.4173351417694575e-06,
      "loss": 0.13,
      "mae_dtheta": 0.029798392206430435,
      "mae_dx": 0.009218362160027027,
      "mae_dy": 0.004688423126935959,
      "pose_mae_dtheta": 0.2455696314573288,
      "pose_mae_dx": 0.08007964491844177,
      "pose_mae_dy": 0.049710631370544434,
      "pose_rmse_dtheta": 0.4118185043334961,
      "pose_rmse_dx": 0.18562515079975128,
      "pose_rmse_dy": 0.12403706461191177,
      "pose_rmse_mean": 0.24049358069896698,
      "rmse_dtheta": 0.04699186235666275,
      "rmse_dx": 0.0198261346668005,
      "rmse_dy": 0.008811782114207745,
      "rmse_mean": 0.025209926068782806,
      "rotation_flip": 0.017077798023819923,
      "sparse_tokens": 10311.0,
      "step": 5745,
      "turn_loss": 0.24395357072353363,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.26695781453261475,
      "grad_norm": 0.6218493580818176,
      "learning_rate": 5.416017521893813e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.04012514278292656,
      "mae_dx": 0.007419859524816275,
      "mae_dy": 0.004171556327491999,
      "pose_mae_dtheta": 0.3344496488571167,
      "pose_mae_dx": 0.06687465310096741,
      "pose_mae_dy": 0.057030122727155685,
      "pose_rmse_dtheta": 0.5756772756576538,
      "pose_rmse_dx": 0.14751161634922028,
      "pose_rmse_dy": 0.12206435203552246,
      "pose_rmse_mean": 0.2817510962486267,
      "rmse_dtheta": 0.05909955874085426,
      "rmse_dx": 0.016789842396974564,
      "rmse_dy": 0.008119909092783928,
      "rmse_mean": 0.028003104031085968,
      "rotation_flip": 0.01123595517128706,
      "sparse_tokens": 10214.0,
      "step": 5746,
      "turn_loss": 0.247761532664299,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2670042742984575,
      "grad_norm": 0.661322832107544,
      "learning_rate": 5.414699872925838e-06,
      "loss": 0.1308,
      "mae_dtheta": 0.012864388525485992,
      "mae_dx": 0.00384758273139596,
      "mae_dy": 0.0022114869207143784,
      "pose_mae_dtheta": 0.10127750784158707,
      "pose_mae_dx": 0.04271189868450165,
      "pose_mae_dy": 0.032907839864492416,
      "pose_rmse_dtheta": 0.24382750689983368,
      "pose_rmse_dx": 0.13913244009017944,
      "pose_rmse_dy": 0.09185680747032166,
      "pose_rmse_mean": 0.15827226638793945,
      "rmse_dtheta": 0.02800423838198185,
      "rmse_dx": 0.012799730524420738,
      "rmse_dy": 0.005584034603089094,
      "rmse_mean": 0.015462668612599373,
      "rotation_flip": 0.004098360426723957,
      "sparse_tokens": 32073.0,
      "step": 5747,
      "turn_loss": 0.11347196251153946,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2670507340643003,
      "grad_norm": 0.5554994940757751,
      "learning_rate": 5.413382194957679e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.009449107572436333,
      "mae_dx": 0.0018576915608718991,
      "mae_dy": 0.0023423130623996258,
      "pose_mae_dtheta": 0.06336567550897598,
      "pose_mae_dx": 0.02415119670331478,
      "pose_mae_dy": 0.021920088678598404,
      "pose_rmse_dtheta": 0.1839469075202942,
      "pose_rmse_dx": 0.06497747451066971,
      "pose_rmse_dy": 0.04667600244283676,
      "pose_rmse_mean": 0.09853346645832062,
      "rmse_dtheta": 0.02379518374800682,
      "rmse_dx": 0.005314147099852562,
      "rmse_dy": 0.005418647080659866,
      "rmse_mean": 0.011509327217936516,
      "rotation_flip": 0.003358209040015936,
      "sparse_tokens": 32105.0,
      "step": 5748,
      "turn_loss": 0.08258955180644989,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.2670971938301431,
      "grad_norm": 1.1837297677993774,
      "learning_rate": 5.412064488081482e-06,
      "loss": 0.1732,
      "mae_dtheta": 0.028797877952456474,
      "mae_dx": 0.010496266186237335,
      "mae_dy": 0.004438220988959074,
      "pose_mae_dtheta": 0.2597191035747528,
      "pose_mae_dx": 0.09007418155670166,
      "pose_mae_dy": 0.03502270206809044,
      "pose_rmse_dtheta": 0.5138221979141235,
      "pose_rmse_dx": 0.19341930747032166,
      "pose_rmse_dy": 0.07739835977554321,
      "pose_rmse_mean": 0.26154664158821106,
      "rmse_dtheta": 0.050196193158626556,
      "rmse_dx": 0.02097124420106411,
      "rmse_dy": 0.009841196238994598,
      "rmse_mean": 0.027002878487110138,
      "rotation_flip": 0.010498687624931335,
      "sparse_tokens": 7520.0,
      "step": 5749,
      "turn_loss": 0.29304206371307373,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.26714365359598585,
      "grad_norm": 0.6292504072189331,
      "learning_rate": 5.410746752389393e-06,
      "loss": 0.0939,
      "mae_dtheta": 0.011537112295627594,
      "mae_dx": 0.0023347754031419754,
      "mae_dy": 0.002401525853201747,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6292505860328674,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.4733428955078,
      "model/head/act_norm_mean": 111.89964094065657,
      "model/head/act_norm_min": 50.916412353515625,
      "model/head/act_over_embed": 76.89848087536322,
      "model/head/grad_frac": 0.09188847243785858,
      "model/head/grad_norm": 0.057820875197649,
      "model/head/grad_zero_frac": 0.00015482862363569438,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6985825047348485,
      "model/head/update_ratio": 0.0009884594473987818,
      "model/head/weight_delta": 8.786849975585938,
      "model/head/weight_delta_rel": 0.15414737164974213,
      "model/head/weight_norm": 58.495948791503906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.420693576335907,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4206298626466995,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42055073380470276,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28906077960963017,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10518942773342133,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06619051098823547,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5501101321585903,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0021397771779447794,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8635711669921875,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0935617983341217,
      "model/modality_embedder.encoders.pose/weight_norm": 30.933364868164062,
      "model/modality_embedder/grad_frac": 0.10518942773342133,
      "model/modality_embedder/grad_norm": 0.06619051098823547,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5501101321585903,
      "model/modality_embedder/update_ratio": 0.0021397771779447794,
      "model/modality_embedder/weight_delta": 2.8635711669921875,
      "model/modality_embedder/weight_delta_rel": 0.0935617983341217,
      "model/modality_embedder/weight_norm": 30.933364868164062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.65777587890625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.803701699535033,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.983470916748047,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.358126661686903,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07688228785991669,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04837822541594505,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017372568836435676,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.2196269035339355,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08088454604148865,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.84747886657715,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.01886749267578,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.809513788680455,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.25091552734375,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.049330145908776,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07836651057004929,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04931217059493065,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016668556490913033,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.813159227371216,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09745003283023834,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.583948135375977,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.4946517944336,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.691726290684624,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.369230270385742,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.34280419883712,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0824996829032898,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05191297456622124,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016996023477986455,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.0324490070343018,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10182396322488785,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.544189453125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.92057800292969,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.48936788520122,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.316466331481934,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.578160332374686,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1045750305056572,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0658039003610611,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022076512686908245,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.589712381362915,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08850407600402832,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.80719757080078,
      "model/normalizer/grad_frac": 0.4071813225746155,
      "model/normalizer/grad_norm": 0.2562190890312195,
      "model/normalizer/grad_zero_frac": 0.00013353643589653075,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003266056999564171,
      "model/normalizer/weight_delta": 5.4865031242370605,
      "model/normalizer/weight_delta_rel": 0.0706629827618599,
      "model/normalizer/weight_norm": 78.44905853271484,
      "pose_mae_dtheta": 0.08330284804105759,
      "pose_mae_dx": 0.02332528866827488,
      "pose_mae_dy": 0.0254341010004282,
      "pose_rmse_dtheta": 0.21979749202728271,
      "pose_rmse_dx": 0.05598072707653046,
      "pose_rmse_dy": 0.05857641622424126,
      "pose_rmse_mean": 0.11145155131816864,
      "rmse_dtheta": 0.02641180343925953,
      "rmse_dx": 0.006541733630001545,
      "rmse_dy": 0.005993745755404234,
      "rmse_mean": 0.012982428073883057,
      "rotation_flip": 0.006231671664863825,
      "sparse_tokens": 32137.0,
      "step": 5750,
      "turn_loss": 0.1023867055773735,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.26719011336182863,
      "grad_norm": 0.473704993724823,
      "learning_rate": 5.409428987973564e-06,
      "loss": 0.1141,
      "mae_dtheta": 0.007396987173706293,
      "mae_dx": 0.0014065008144825697,
      "mae_dy": 0.0003508590452838689,
      "pose_mae_dtheta": 0.052662186324596405,
      "pose_mae_dx": 0.010254988446831703,
      "pose_mae_dy": 0.005047337152063847,
      "pose_rmse_dtheta": 0.21870091557502747,
      "pose_rmse_dx": 0.025208089500665665,
      "pose_rmse_dy": 0.013808229006826878,
      "pose_rmse_mean": 0.08590574562549591,
      "rmse_dtheta": 0.02734709344804287,
      "rmse_dx": 0.004134182818233967,
      "rmse_dy": 0.0007876722957007587,
      "rmse_mean": 0.010756316594779491,
      "rotation_flip": 0.0017772511346265674,
      "sparse_tokens": 32201.0,
      "step": 5751,
      "turn_loss": 0.038764212280511856,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.26723657312767146,
      "grad_norm": 0.61477130651474,
      "learning_rate": 5.408111194926145e-06,
      "loss": 0.196,
      "mae_dtheta": 0.03964119032025337,
      "mae_dx": 0.013776177540421486,
      "mae_dy": 0.004864892922341824,
      "pose_mae_dtheta": 0.3260241746902466,
      "pose_mae_dx": 0.10330162197351456,
      "pose_mae_dy": 0.04580490291118622,
      "pose_rmse_dtheta": 0.506906270980835,
      "pose_rmse_dx": 0.20446643233299255,
      "pose_rmse_dy": 0.1009177640080452,
      "pose_rmse_mean": 0.2707635164260864,
      "rmse_dtheta": 0.055564142763614655,
      "rmse_dx": 0.02512393705546856,
      "rmse_dy": 0.00932706892490387,
      "rmse_mean": 0.03000505082309246,
      "rotation_flip": 0.008343265391886234,
      "sparse_tokens": 13978.0,
      "step": 5752,
      "turn_loss": 0.32442110776901245,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.26728303289351424,
      "grad_norm": 0.4401063919067383,
      "learning_rate": 5.406793373339292e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.009518278762698174,
      "mae_dx": 0.0014566039899364114,
      "mae_dy": 0.00025042062043212354,
      "pose_mae_dtheta": 0.06746446341276169,
      "pose_mae_dx": 0.01223746594041586,
      "pose_mae_dy": 0.0033915922977030277,
      "pose_rmse_dtheta": 0.27904728055000305,
      "pose_rmse_dx": 0.02493472211062908,
      "pose_rmse_dy": 0.006253045052289963,
      "pose_rmse_mean": 0.10341167449951172,
      "rmse_dtheta": 0.03347913175821304,
      "rmse_dx": 0.0037203943356871605,
      "rmse_dy": 0.0005087070167064667,
      "rmse_mean": 0.012569411657750607,
      "rotation_flip": 0.0010565239936113358,
      "sparse_tokens": 32265.0,
      "step": 5753,
      "turn_loss": 0.051111701875925064,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.267329492659357,
      "grad_norm": 0.5516958236694336,
      "learning_rate": 5.40547552330516e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.013259858824312687,
      "mae_dx": 0.001950377831235528,
      "mae_dy": 0.0039314087480306625,
      "pose_mae_dtheta": 0.08439315855503082,
      "pose_mae_dx": 0.029920710250735283,
      "pose_mae_dy": 0.04142051190137863,
      "pose_rmse_dtheta": 0.16006627678871155,
      "pose_rmse_dx": 0.0785328596830368,
      "pose_rmse_dy": 0.09460179507732391,
      "pose_rmse_mean": 0.11106698215007782,
      "rmse_dtheta": 0.02313150092959404,
      "rmse_dx": 0.004898331593722105,
      "rmse_dy": 0.00813893973827362,
      "rmse_mean": 0.012056257575750351,
      "rotation_flip": 0.007738896179944277,
      "sparse_tokens": 32089.0,
      "step": 5754,
      "turn_loss": 0.12950292229652405,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2673759524251998,
      "grad_norm": 0.3838254511356354,
      "learning_rate": 5.404157644915907e-06,
      "loss": 0.1095,
      "mae_dtheta": 0.009721762500703335,
      "mae_dx": 0.0017720317700877786,
      "mae_dy": 0.002680076053366065,
      "pose_mae_dtheta": 0.061333224177360535,
      "pose_mae_dx": 0.024740837514400482,
      "pose_mae_dy": 0.03205488994717598,
      "pose_rmse_dtheta": 0.11481255292892456,
      "pose_rmse_dx": 0.062435247004032135,
      "pose_rmse_dy": 0.07418595999479294,
      "pose_rmse_mean": 0.08381125330924988,
      "rmse_dtheta": 0.018028419464826584,
      "rmse_dx": 0.0047116391360759735,
      "rmse_dy": 0.005647985730320215,
      "rmse_mean": 0.009462681598961353,
      "rotation_flip": 0.008855827152729034,
      "sparse_tokens": 32121.0,
      "step": 5755,
      "turn_loss": 0.08902785927057266,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.26742241219104257,
      "grad_norm": 1.043393850326538,
      "learning_rate": 5.402839738263693e-06,
      "loss": 0.3049,
      "mae_dtheta": 0.03868380934000015,
      "mae_dx": 0.011692957021296024,
      "mae_dy": 0.006625097710639238,
      "pose_mae_dtheta": 0.3081094026565552,
      "pose_mae_dx": 0.08778810501098633,
      "pose_mae_dy": 0.06301886588335037,
      "pose_rmse_dtheta": 0.5609129667282104,
      "pose_rmse_dx": 0.18440121412277222,
      "pose_rmse_dy": 0.21413210034370422,
      "pose_rmse_mean": 0.319815456867218,
      "rmse_dtheta": 0.06008658558130264,
      "rmse_dx": 0.02342965640127659,
      "rmse_dy": 0.017644420266151428,
      "rmse_mean": 0.0337202213704586,
      "rotation_flip": 0.007475083228200674,
      "sparse_tokens": 21007.0,
      "step": 5756,
      "turn_loss": 0.3016361892223358,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.26746887195688535,
      "grad_norm": 0.5394423604011536,
      "learning_rate": 5.40152180344068e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.03276452794671059,
      "mae_dx": 0.006463978905230761,
      "mae_dy": 0.003456465434283018,
      "pose_mae_dtheta": 0.27625566720962524,
      "pose_mae_dx": 0.06933066993951797,
      "pose_mae_dy": 0.04867567867040634,
      "pose_rmse_dtheta": 0.4811181128025055,
      "pose_rmse_dx": 0.20921553671360016,
      "pose_rmse_dy": 0.12123272567987442,
      "pose_rmse_mean": 0.2705221474170685,
      "rmse_dtheta": 0.053951628506183624,
      "rmse_dx": 0.018407030031085014,
      "rmse_dy": 0.007142302580177784,
      "rmse_mean": 0.026500321924686432,
      "rotation_flip": 0.009216589853167534,
      "sparse_tokens": 4297.0,
      "step": 5757,
      "turn_loss": 0.2670850157737732,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2675153317227281,
      "grad_norm": 0.5212860107421875,
      "learning_rate": 5.400203840539032e-06,
      "loss": 0.1099,
      "mae_dtheta": 0.013247529976069927,
      "mae_dx": 0.0032322939950972795,
      "mae_dy": 0.0020988276228308678,
      "pose_mae_dtheta": 0.0983661636710167,
      "pose_mae_dx": 0.02644157037138939,
      "pose_mae_dy": 0.02360345982015133,
      "pose_rmse_dtheta": 0.2876920700073242,
      "pose_rmse_dx": 0.09140348434448242,
      "pose_rmse_dy": 0.08556628227233887,
      "pose_rmse_mean": 0.15488728880882263,
      "rmse_dtheta": 0.03280244022607803,
      "rmse_dx": 0.010739256627857685,
      "rmse_dy": 0.007093291729688644,
      "rmse_mean": 0.01687832921743393,
      "rotation_flip": 0.0034079845063388348,
      "sparse_tokens": 32153.0,
      "step": 5758,
      "turn_loss": 0.10413527488708496,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2675617914885709,
      "grad_norm": 0.4168351888656616,
      "learning_rate": 5.398885849650913e-06,
      "loss": 0.0625,
      "mae_dtheta": 0.008592589758336544,
      "mae_dx": 0.0009942441247403622,
      "mae_dy": 0.0014223032630980015,
      "pose_mae_dtheta": 0.05584754794836044,
      "pose_mae_dx": 0.011647971346974373,
      "pose_mae_dy": 0.018002644181251526,
      "pose_rmse_dtheta": 0.1845676153898239,
      "pose_rmse_dx": 0.02960151433944702,
      "pose_rmse_dy": 0.04271458089351654,
      "pose_rmse_mean": 0.08562790602445602,
      "rmse_dtheta": 0.02392333745956421,
      "rmse_dx": 0.0029885289259254932,
      "rmse_dy": 0.0029982696287333965,
      "rmse_mean": 0.009970045648515224,
      "rotation_flip": 0.0030674845911562443,
      "sparse_tokens": 32121.0,
      "step": 5759,
      "turn_loss": 0.05832057446241379,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2676082512544137,
      "grad_norm": 0.5017634630203247,
      "learning_rate": 5.397567830868493e-06,
      "loss": 0.0991,
      "mae_dtheta": 0.008698849938809872,
      "mae_dx": 0.0015907351626083255,
      "mae_dy": 0.0017423651879653335,
      "pose_mae_dtheta": 0.05917007103562355,
      "pose_mae_dx": 0.018798425793647766,
      "pose_mae_dy": 0.020294276997447014,
      "pose_rmse_dtheta": 0.1615803986787796,
      "pose_rmse_dx": 0.05085280165076256,
      "pose_rmse_dy": 0.04755030572414398,
      "pose_rmse_mean": 0.08666117489337921,
      "rmse_dtheta": 0.02179580368101597,
      "rmse_dx": 0.005122707691043615,
      "rmse_dy": 0.003840373596176505,
      "rmse_mean": 0.01025296188890934,
      "rotation_flip": 0.004594180732965469,
      "sparse_tokens": 32073.0,
      "step": 5760,
      "turn_loss": 0.06810153275728226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.26765471102025645,
      "grad_norm": 0.6191610097885132,
      "learning_rate": 5.396249784283943e-06,
      "loss": 0.1647,
      "mae_dtheta": 0.04642888158559799,
      "mae_dx": 0.007057665381580591,
      "mae_dy": 0.002180725336074829,
      "pose_mae_dtheta": 0.4111987352371216,
      "pose_mae_dx": 0.055751074105501175,
      "pose_mae_dy": 0.02007676661014557,
      "pose_rmse_dtheta": 0.6344229578971863,
      "pose_rmse_dx": 0.15113164484500885,
      "pose_rmse_dy": 0.04666965454816818,
      "pose_rmse_mean": 0.27740809321403503,
      "rmse_dtheta": 0.06452902406454086,
      "rmse_dx": 0.01751089282333851,
      "rmse_dy": 0.005265060346573591,
      "rmse_mean": 0.0291016586124897,
      "rotation_flip": 0.014909477904438972,
      "sparse_tokens": 14617.0,
      "step": 5761,
      "turn_loss": 0.3122046887874603,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.26770117078609923,
      "grad_norm": 0.4340735077857971,
      "learning_rate": 5.394931709989431e-06,
      "loss": 0.0878,
      "mae_dtheta": 0.030802274122834206,
      "mae_dx": 0.01178442407399416,
      "mae_dy": 0.0059508089907467365,
      "pose_mae_dtheta": 0.25269338488578796,
      "pose_mae_dx": 0.11016105860471725,
      "pose_mae_dy": 0.0667438954114914,
      "pose_rmse_dtheta": 0.4695884883403778,
      "pose_rmse_dx": 0.23603618144989014,
      "pose_rmse_dy": 0.14124637842178345,
      "pose_rmse_mean": 0.28229036927223206,
      "rmse_dtheta": 0.04958128184080124,
      "rmse_dx": 0.023775259032845497,
      "rmse_dy": 0.011705176904797554,
      "rmse_mean": 0.02835390530526638,
      "rotation_flip": 0.009510869160294533,
      "sparse_tokens": 14730.0,
      "step": 5762,
      "turn_loss": 0.25347110629081726,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.267747630551942,
      "grad_norm": 0.506725549697876,
      "learning_rate": 5.393613608077134e-06,
      "loss": 0.1121,
      "mae_dtheta": 0.028831185773015022,
      "mae_dx": 0.006343910936266184,
      "mae_dy": 0.002528274431824684,
      "pose_mae_dtheta": 0.18081623315811157,
      "pose_mae_dx": 0.05387432873249054,
      "pose_mae_dy": 0.024620458483695984,
      "pose_rmse_dtheta": 0.34157702326774597,
      "pose_rmse_dx": 0.12979941070079803,
      "pose_rmse_dy": 0.061326537281274796,
      "pose_rmse_mean": 0.17756766080856323,
      "rmse_dtheta": 0.04806745424866676,
      "rmse_dx": 0.014328797347843647,
      "rmse_dy": 0.00564745906740427,
      "rmse_mean": 0.022681236267089844,
      "rotation_flip": 0.012987012974917889,
      "sparse_tokens": 5600.0,
      "step": 5763,
      "turn_loss": 0.16881684958934784,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.2677940903177848,
      "grad_norm": 0.5920926928520203,
      "learning_rate": 5.392295478639226e-06,
      "loss": 0.1321,
      "mae_dtheta": 0.028284505009651184,
      "mae_dx": 0.012302284128963947,
      "mae_dy": 0.006222735624760389,
      "pose_mae_dtheta": 0.21050439774990082,
      "pose_mae_dx": 0.10049571096897125,
      "pose_mae_dy": 0.08644881844520569,
      "pose_rmse_dtheta": 0.3442751467227936,
      "pose_rmse_dx": 0.2291513830423355,
      "pose_rmse_dy": 0.16742365062236786,
      "pose_rmse_mean": 0.24695007503032684,
      "rmse_dtheta": 0.04032289981842041,
      "rmse_dx": 0.026995088905096054,
      "rmse_dy": 0.009750212542712688,
      "rmse_mean": 0.025689400732517242,
      "rotation_flip": 0.00764818349853158,
      "sparse_tokens": 9145.0,
      "step": 5764,
      "turn_loss": 0.22428154945373535,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.26784055008362756,
      "grad_norm": 0.9490113258361816,
      "learning_rate": 5.390977321767884e-06,
      "loss": 0.223,
      "mae_dtheta": 0.039642490446567535,
      "mae_dx": 0.011238813400268555,
      "mae_dy": 0.004293801262974739,
      "pose_mae_dtheta": 0.3405269980430603,
      "pose_mae_dx": 0.09072330594062805,
      "pose_mae_dy": 0.04994095116853714,
      "pose_rmse_dtheta": 0.6021565198898315,
      "pose_rmse_dx": 0.19867482781410217,
      "pose_rmse_dy": 0.12498246878385544,
      "pose_rmse_mean": 0.3086045980453491,
      "rmse_dtheta": 0.059161048382520676,
      "rmse_dx": 0.022552145645022392,
      "rmse_dy": 0.008844247087836266,
      "rmse_mean": 0.030185814946889877,
      "rotation_flip": 0.013181019574403763,
      "sparse_tokens": 19390.0,
      "step": 5765,
      "turn_loss": 0.27111268043518066,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.26788700984947034,
      "grad_norm": 0.5489240288734436,
      "learning_rate": 5.389659137555287e-06,
      "loss": 0.1485,
      "mae_dtheta": 0.012691550888121128,
      "mae_dx": 0.003572129877284169,
      "mae_dy": 0.004955784883350134,
      "pose_mae_dtheta": 0.08949059247970581,
      "pose_mae_dx": 0.04026149958372116,
      "pose_mae_dy": 0.04527931287884712,
      "pose_rmse_dtheta": 0.16497063636779785,
      "pose_rmse_dx": 0.08457605540752411,
      "pose_rmse_dy": 0.09829847514629364,
      "pose_rmse_mean": 0.1159483939409256,
      "rmse_dtheta": 0.022612744942307472,
      "rmse_dx": 0.007992799393832684,
      "rmse_dy": 0.009883861057460308,
      "rmse_mean": 0.013496468774974346,
      "rotation_flip": 0.008461297489702702,
      "sparse_tokens": 32121.0,
      "step": 5766,
      "turn_loss": 0.168700709939003,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.2679334696153131,
      "grad_norm": 0.5253303050994873,
      "learning_rate": 5.388340926093619e-06,
      "loss": 0.1109,
      "mae_dtheta": 0.02690899558365345,
      "mae_dx": 0.01263023167848587,
      "mae_dy": 0.0032153590582311153,
      "pose_mae_dtheta": 0.20967456698417664,
      "pose_mae_dx": 0.1008990928530693,
      "pose_mae_dy": 0.034004390239715576,
      "pose_rmse_dtheta": 0.37190017104148865,
      "pose_rmse_dx": 0.20855365693569183,
      "pose_rmse_dy": 0.08996941149234772,
      "pose_rmse_mean": 0.2234744131565094,
      "rmse_dtheta": 0.042742419987916946,
      "rmse_dx": 0.024303879588842392,
      "rmse_dy": 0.006555939093232155,
      "rmse_mean": 0.024534080177545547,
      "rotation_flip": 0.009782608598470688,
      "sparse_tokens": 14688.0,
      "step": 5767,
      "turn_loss": 0.1684410125017166,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.26797992938115595,
      "grad_norm": 0.574600100517273,
      "learning_rate": 5.387022687475062e-06,
      "loss": 0.1387,
      "mae_dtheta": 0.011768313124775887,
      "mae_dx": 0.003833141876384616,
      "mae_dy": 0.001346031785942614,
      "pose_mae_dtheta": 0.08832023292779922,
      "pose_mae_dx": 0.03109804168343544,
      "pose_mae_dy": 0.016139352694153786,
      "pose_rmse_dtheta": 0.3069739043712616,
      "pose_rmse_dx": 0.07951568812131882,
      "pose_rmse_dy": 0.062015827745199203,
      "pose_rmse_mean": 0.14950181543827057,
      "rmse_dtheta": 0.03515071049332619,
      "rmse_dx": 0.010478663258254528,
      "rmse_dy": 0.005654055625200272,
      "rmse_mean": 0.017094478011131287,
      "rotation_flip": 0.00214018183760345,
      "sparse_tokens": 32185.0,
      "step": 5768,
      "turn_loss": 0.12808826565742493,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.2680263891469987,
      "grad_norm": 0.44463714957237244,
      "learning_rate": 5.385704421791799e-06,
      "loss": 0.1294,
      "mae_dtheta": 0.010657120496034622,
      "mae_dx": 0.002149979118257761,
      "mae_dy": 0.00247311033308506,
      "pose_mae_dtheta": 0.07418934255838394,
      "pose_mae_dx": 0.0252450630068779,
      "pose_mae_dy": 0.03277840092778206,
      "pose_rmse_dtheta": 0.15119169652462006,
      "pose_rmse_dx": 0.06517477333545685,
      "pose_rmse_dy": 0.07891222089529037,
      "pose_rmse_mean": 0.09842623770236969,
      "rmse_dtheta": 0.021509842947125435,
      "rmse_dx": 0.006928120274096727,
      "rmse_dy": 0.005675042513757944,
      "rmse_mean": 0.011371001601219177,
      "rotation_flip": 0.0030198446474969387,
      "sparse_tokens": 32025.0,
      "step": 5769,
      "turn_loss": 0.10262078791856766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.2680728489128415,
      "grad_norm": 0.5258082151412964,
      "learning_rate": 5.38438612913602e-06,
      "loss": 0.1204,
      "mae_dtheta": 0.03585710749030113,
      "mae_dx": 0.016078785061836243,
      "mae_dy": 0.004911742638796568,
      "pose_mae_dtheta": 0.2838265895843506,
      "pose_mae_dx": 0.12651824951171875,
      "pose_mae_dy": 0.05790998414158821,
      "pose_rmse_dtheta": 0.5056856274604797,
      "pose_rmse_dx": 0.2651517689228058,
      "pose_rmse_dy": 0.12601223587989807,
      "pose_rmse_mean": 0.2989498972892761,
      "rmse_dtheta": 0.05349959060549736,
      "rmse_dx": 0.029775502160191536,
      "rmse_dy": 0.00822805892676115,
      "rmse_mean": 0.030501050874590874,
      "rotation_flip": 0.021105527877807617,
      "sparse_tokens": 18492.0,
      "step": 5770,
      "turn_loss": 0.2494623214006424,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.2681193086786843,
      "grad_norm": 0.5030274987220764,
      "learning_rate": 5.3830678095999125e-06,
      "loss": 0.1243,
      "mae_dtheta": 0.03253970667719841,
      "mae_dx": 0.01290073711425066,
      "mae_dy": 0.0038080685772001743,
      "pose_mae_dtheta": 0.2293834537267685,
      "pose_mae_dx": 0.09565507620573044,
      "pose_mae_dy": 0.05409744754433632,
      "pose_rmse_dtheta": 0.41748955845832825,
      "pose_rmse_dx": 0.2273314893245697,
      "pose_rmse_dy": 0.14302590489387512,
      "pose_rmse_mean": 0.2626156508922577,
      "rmse_dtheta": 0.051291435956954956,
      "rmse_dx": 0.02670269086956978,
      "rmse_dy": 0.008285745978355408,
      "rmse_mean": 0.02875995635986328,
      "rotation_flip": 0.016393441706895828,
      "sparse_tokens": 7135.0,
      "step": 5771,
      "turn_loss": 0.2556537687778473,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.26816576844452705,
      "grad_norm": 0.5965802669525146,
      "learning_rate": 5.381749463275666e-06,
      "loss": 0.1533,
      "mae_dtheta": 0.010458391159772873,
      "mae_dx": 0.0020845490507781506,
      "mae_dy": 0.0018067068886011839,
      "pose_mae_dtheta": 0.07431131601333618,
      "pose_mae_dx": 0.02329092100262642,
      "pose_mae_dy": 0.024425417184829712,
      "pose_rmse_dtheta": 0.16669189929962158,
      "pose_rmse_dx": 0.058620549738407135,
      "pose_rmse_dy": 0.0681789219379425,
      "pose_rmse_mean": 0.09783045947551727,
      "rmse_dtheta": 0.021783217787742615,
      "rmse_dx": 0.006688214372843504,
      "rmse_dy": 0.0040387301705777645,
      "rmse_mean": 0.01083672046661377,
      "rotation_flip": 0.0038314175326377153,
      "sparse_tokens": 32137.0,
      "step": 5772,
      "turn_loss": 0.08691014349460602,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.26821222821036983,
      "grad_norm": 0.6191921830177307,
      "learning_rate": 5.380431090255475e-06,
      "loss": 0.0785,
      "mae_dtheta": 0.008146707899868488,
      "mae_dx": 0.0015787240117788315,
      "mae_dy": 0.0004859156033489853,
      "pose_mae_dtheta": 0.0551336295902729,
      "pose_mae_dx": 0.014136293902993202,
      "pose_mae_dy": 0.00593145377933979,
      "pose_rmse_dtheta": 0.22130651772022247,
      "pose_rmse_dx": 0.03155184164643288,
      "pose_rmse_dy": 0.020625101402401924,
      "pose_rmse_mean": 0.09116116166114807,
      "rmse_dtheta": 0.028194069862365723,
      "rmse_dx": 0.004396545235067606,
      "rmse_dy": 0.0012968732044100761,
      "rmse_mean": 0.011295830830931664,
      "rotation_flip": 0.003655352396890521,
      "sparse_tokens": 32217.0,
      "step": 5773,
      "turn_loss": 0.0509650744497776,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.2682586879762126,
      "grad_norm": 0.6445499658584595,
      "learning_rate": 5.379112690631536e-06,
      "loss": 0.1676,
      "mae_dtheta": 0.04244538024067879,
      "mae_dx": 0.014568384736776352,
      "mae_dy": 0.004027696792036295,
      "pose_mae_dtheta": 0.36859261989593506,
      "pose_mae_dx": 0.11577141284942627,
      "pose_mae_dy": 0.04870040342211723,
      "pose_rmse_dtheta": 0.6020082831382751,
      "pose_rmse_dx": 0.23514655232429504,
      "pose_rmse_dy": 0.1191391795873642,
      "pose_rmse_mean": 0.31876468658447266,
      "rmse_dtheta": 0.059542346745729446,
      "rmse_dx": 0.026854272931814194,
      "rmse_dy": 0.008209272287786007,
      "rmse_mean": 0.03153529763221741,
      "rotation_flip": 0.010434783063828945,
      "sparse_tokens": 19946.0,
      "step": 5774,
      "turn_loss": 0.31833308935165405,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.2683051477420554,
      "grad_norm": 0.757667601108551,
      "learning_rate": 5.377794264496041e-06,
      "loss": 0.1722,
      "mae_dtheta": 0.04610080644488335,
      "mae_dx": 0.016066385433077812,
      "mae_dy": 0.007506328634917736,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7576677203178406,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 148.246337890625,
      "model/head/act_norm_mean": 104.32083777225378,
      "model/head/act_norm_min": 68.37690734863281,
      "model/head/act_over_embed": 71.69025638416366,
      "model/head/grad_frac": 0.09337194263935089,
      "model/head/grad_norm": 0.07074490934610367,
      "model/head/grad_zero_frac": 0.00019543941016308963,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6951645359848485,
      "model/head/update_ratio": 0.001209337031468749,
      "model/head/weight_delta": 8.800673484802246,
      "model/head/weight_delta_rel": 0.1543898731470108,
      "model/head/weight_norm": 58.49891662597656,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4208005964756012,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.420747252071605,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42068997025489807,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2891414507214424,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09366588294506073,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07096761465072632,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5464154411764706,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0022941904608160257,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8649518489837646,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09360690414905548,
      "model/modality_embedder.encoders.pose/weight_norm": 30.933618545532227,
      "model/modality_embedder/grad_frac": 0.09366588294506073,
      "model/modality_embedder/grad_norm": 0.07096761465072632,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5464154411764706,
      "model/modality_embedder/update_ratio": 0.0022941904608160257,
      "model/modality_embedder/weight_delta": 2.8649518489837646,
      "model/modality_embedder/weight_delta_rel": 0.09360690414905548,
      "model/modality_embedder/weight_norm": 30.933618545532227,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.25068664550781,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.059223184223185,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.178027153015137,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.84651405604693,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08396130800247192,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06361477077007294,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002284277230501175,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.2256484031677246,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08110397309064865,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.84897232055664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.91163635253906,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.873570150913903,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.92658805847168,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.406140915593213,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08120103180408478,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.061523400247097015,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0020794908050447702,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.820556879043579,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09770629554986954,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.58580207824707,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.72798156738281,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.510418545574794,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.248717308044434,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.530998456820285,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08162932097911835,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06184789910912514,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0020247234497219324,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.040120840072632,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10208156704902649,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.546344757080078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 82.70330047607422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.48881485990861,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.033536911010742,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.8905709260686,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07699108868837357,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.058333661407232285,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.00195695785805583,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.596298933029175,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08872917294502258,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.808338165283203,
      "model/normalizer/grad_frac": 0.2826768159866333,
      "model/normalizer/grad_norm": 0.21417510509490967,
      "model/normalizer/grad_zero_frac": 0.00019616857753135264,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0027300387155264616,
      "model/normalizer/weight_delta": 5.500666618347168,
      "model/normalizer/weight_delta_rel": 0.07084540277719498,
      "model/normalizer/weight_norm": 78.45130920410156,
      "pose_mae_dtheta": 0.3546162247657776,
      "pose_mae_dx": 0.12109166383743286,
      "pose_mae_dy": 0.0908311977982521,
      "pose_rmse_dtheta": 0.5936509370803833,
      "pose_rmse_dx": 0.24232381582260132,
      "pose_rmse_dy": 0.23849321901798248,
      "pose_rmse_mean": 0.3581560254096985,
      "rmse_dtheta": 0.063911572098732,
      "rmse_dx": 0.029344186186790466,
      "rmse_dy": 0.013873986899852753,
      "rmse_mean": 0.035709917545318604,
      "rotation_flip": 0.009433962404727936,
      "sparse_tokens": 9276.0,
      "step": 5775,
      "turn_loss": 0.3005357086658478,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.26835160750789816,
      "grad_norm": 0.4168907701969147,
      "learning_rate": 5.3764758119411905e-06,
      "loss": 0.0889,
      "mae_dtheta": 0.01227100845426321,
      "mae_dx": 0.0021329361479729414,
      "mae_dy": 0.0033815528731793165,
      "pose_mae_dtheta": 0.07624141871929169,
      "pose_mae_dx": 0.027696281671524048,
      "pose_mae_dy": 0.04086854308843613,
      "pose_rmse_dtheta": 0.17639748752117157,
      "pose_rmse_dx": 0.07099804282188416,
      "pose_rmse_dy": 0.09446220099925995,
      "pose_rmse_mean": 0.11395257711410522,
      "rmse_dtheta": 0.024310946464538574,
      "rmse_dx": 0.006292187143117189,
      "rmse_dy": 0.006700274534523487,
      "rmse_mean": 0.012434469535946846,
      "rotation_flip": 0.0058309040032327175,
      "sparse_tokens": 32121.0,
      "step": 5776,
      "turn_loss": 0.10251419246196747,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.26839806727374094,
      "grad_norm": 0.4626776874065399,
      "learning_rate": 5.3751573330591855e-06,
      "loss": 0.0935,
      "mae_dtheta": 0.0074892896227538586,
      "mae_dx": 0.0018521485617384315,
      "mae_dy": 0.0015308823203667998,
      "pose_mae_dtheta": 0.053430382162332535,
      "pose_mae_dx": 0.02288770116865635,
      "pose_mae_dy": 0.019581491127610207,
      "pose_rmse_dtheta": 0.13633540272712708,
      "pose_rmse_dx": 0.06246091052889824,
      "pose_rmse_dy": 0.04589417576789856,
      "pose_rmse_mean": 0.08156350255012512,
      "rmse_dtheta": 0.017947690561413765,
      "rmse_dx": 0.00659599807113409,
      "rmse_dy": 0.0033186529763042927,
      "rmse_mean": 0.009287446737289429,
      "rotation_flip": 0.0025484198704361916,
      "sparse_tokens": 32073.0,
      "step": 5777,
      "turn_loss": 0.06512578576803207,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2684445270395837,
      "grad_norm": 0.36756712198257446,
      "learning_rate": 5.373838827942225e-06,
      "loss": 0.0992,
      "mae_dtheta": 0.009012882597744465,
      "mae_dx": 0.001297492883168161,
      "mae_dy": 0.0016420070314779878,
      "pose_mae_dtheta": 0.06263512372970581,
      "pose_mae_dx": 0.01567539945244789,
      "pose_mae_dy": 0.017619239166378975,
      "pose_rmse_dtheta": 0.22022061049938202,
      "pose_rmse_dx": 0.04220195487141609,
      "pose_rmse_dy": 0.03910277411341667,
      "pose_rmse_mean": 0.1005084440112114,
      "rmse_dtheta": 0.02439778298139572,
      "rmse_dx": 0.0045215594582259655,
      "rmse_dy": 0.00418570963665843,
      "rmse_mean": 0.011035017669200897,
      "rotation_flip": 0.005494505632668734,
      "sparse_tokens": 32073.0,
      "step": 5778,
      "turn_loss": 0.06723791360855103,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2684909868054265,
      "grad_norm": 0.35256022214889526,
      "learning_rate": 5.372520296682516e-06,
      "loss": 0.1112,
      "mae_dtheta": 0.007850147783756256,
      "mae_dx": 0.001349863363429904,
      "mae_dy": 0.0017027555732056499,
      "pose_mae_dtheta": 0.05016011372208595,
      "pose_mae_dx": 0.018235327675938606,
      "pose_mae_dy": 0.023950383067131042,
      "pose_rmse_dtheta": 0.12557652592658997,
      "pose_rmse_dx": 0.05362911894917488,
      "pose_rmse_dy": 0.05999904125928879,
      "pose_rmse_mean": 0.07973489165306091,
      "rmse_dtheta": 0.01832985319197178,
      "rmse_dx": 0.0045505911111831665,
      "rmse_dy": 0.004017006140202284,
      "rmse_mean": 0.008965817280113697,
      "rotation_flip": 0.002464268123731017,
      "sparse_tokens": 32057.0,
      "step": 5779,
      "turn_loss": 0.0635409951210022,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.26853744657126927,
      "grad_norm": 0.5440636277198792,
      "learning_rate": 5.3712017393722625e-06,
      "loss": 0.1396,
      "mae_dtheta": 0.014285072684288025,
      "mae_dx": 0.0023800241760909557,
      "mae_dy": 0.003625687211751938,
      "pose_mae_dtheta": 0.09937211871147156,
      "pose_mae_dx": 0.032723553478717804,
      "pose_mae_dy": 0.04108336195349693,
      "pose_rmse_dtheta": 0.22878356277942657,
      "pose_rmse_dx": 0.07988010346889496,
      "pose_rmse_dy": 0.08837196230888367,
      "pose_rmse_mean": 0.13234521448612213,
      "rmse_dtheta": 0.028597107157111168,
      "rmse_dx": 0.008311542682349682,
      "rmse_dy": 0.0073247323743999004,
      "rmse_mean": 0.014744460582733154,
      "rotation_flip": 0.007397444453090429,
      "sparse_tokens": 32089.0,
      "step": 5780,
      "turn_loss": 0.13192066550254822,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.26858390633711204,
      "grad_norm": 0.9327223896980286,
      "learning_rate": 5.369883156103672e-06,
      "loss": 0.1924,
      "mae_dtheta": 0.013437898829579353,
      "mae_dx": 0.00497343810275197,
      "mae_dy": 0.0030259997583925724,
      "pose_mae_dtheta": 0.09894745796918869,
      "pose_mae_dx": 0.053045254200696945,
      "pose_mae_dy": 0.041708480566740036,
      "pose_rmse_dtheta": 0.2152620255947113,
      "pose_rmse_dx": 0.14415080845355988,
      "pose_rmse_dy": 0.10534805804491043,
      "pose_rmse_mean": 0.1549203097820282,
      "rmse_dtheta": 0.02575989067554474,
      "rmse_dx": 0.014422206208109856,
      "rmse_dy": 0.006444981787353754,
      "rmse_mean": 0.015542360953986645,
      "rotation_flip": 0.005737704690545797,
      "sparse_tokens": 32073.0,
      "step": 5781,
      "turn_loss": 0.1381608098745346,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.2686303661029548,
      "grad_norm": 0.5176664590835571,
      "learning_rate": 5.368564546968954e-06,
      "loss": 0.1369,
      "mae_dtheta": 0.039738379418849945,
      "mae_dx": 0.012178627774119377,
      "mae_dy": 0.007119270041584969,
      "pose_mae_dtheta": 0.28267741203308105,
      "pose_mae_dx": 0.09443417936563492,
      "pose_mae_dy": 0.06845006346702576,
      "pose_rmse_dtheta": 0.47259172797203064,
      "pose_rmse_dx": 0.17118220031261444,
      "pose_rmse_dy": 0.16349034011363983,
      "pose_rmse_mean": 0.26908808946609497,
      "rmse_dtheta": 0.057630132883787155,
      "rmse_dx": 0.022705763578414917,
      "rmse_dy": 0.014044215902686119,
      "rmse_mean": 0.03146003931760788,
      "rotation_flip": 0.01579778827726841,
      "sparse_tokens": 11380.0,
      "step": 5782,
      "turn_loss": 0.30762410163879395,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.2686768258687976,
      "grad_norm": 0.5082867741584778,
      "learning_rate": 5.3672459120603195e-06,
      "loss": 0.112,
      "mae_dtheta": 0.03007437102496624,
      "mae_dx": 0.010469877161085606,
      "mae_dy": 0.0046030269004404545,
      "pose_mae_dtheta": 0.2093462347984314,
      "pose_mae_dx": 0.0798223465681076,
      "pose_mae_dy": 0.05517375469207764,
      "pose_rmse_dtheta": 0.39711520075798035,
      "pose_rmse_dx": 0.20139318704605103,
      "pose_rmse_dy": 0.13425213098526,
      "pose_rmse_mean": 0.2442535012960434,
      "rmse_dtheta": 0.048644740134477615,
      "rmse_dx": 0.02352423220872879,
      "rmse_dy": 0.008952520787715912,
      "rmse_mean": 0.027040500193834305,
      "rotation_flip": 0.010292952880263329,
      "sparse_tokens": 22367.0,
      "step": 5783,
      "turn_loss": 0.23955579102039337,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2687232856346404,
      "grad_norm": 0.7480453848838806,
      "learning_rate": 5.365927251469981e-06,
      "loss": 0.1543,
      "mae_dtheta": 0.00997948832809925,
      "mae_dx": 0.0016622584080323577,
      "mae_dy": 0.002005551476031542,
      "pose_mae_dtheta": 0.06570855528116226,
      "pose_mae_dx": 0.021219586953520775,
      "pose_mae_dy": 0.026470134034752846,
      "pose_rmse_dtheta": 0.16789470613002777,
      "pose_rmse_dx": 0.049283161759376526,
      "pose_rmse_dy": 0.06024368479847908,
      "pose_rmse_mean": 0.09247385710477829,
      "rmse_dtheta": 0.023744208738207817,
      "rmse_dx": 0.004942065570503473,
      "rmse_dy": 0.004503756761550903,
      "rmse_mean": 0.011063343845307827,
      "rotation_flip": 0.0028503562789410353,
      "sparse_tokens": 32073.0,
      "step": 5784,
      "turn_loss": 0.08206155896186829,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2687697454004832,
      "grad_norm": 0.7809762954711914,
      "learning_rate": 5.364608565290154e-06,
      "loss": 0.1334,
      "mae_dtheta": 0.00826994702219963,
      "mae_dx": 0.001618974725715816,
      "mae_dy": 0.0016752119408920407,
      "pose_mae_dtheta": 0.05386299639940262,
      "pose_mae_dx": 0.018641717731952667,
      "pose_mae_dy": 0.024244800209999084,
      "pose_rmse_dtheta": 0.10686270147562027,
      "pose_rmse_dx": 0.04487302526831627,
      "pose_rmse_dy": 0.057412635535001755,
      "pose_rmse_mean": 0.06971612572669983,
      "rmse_dtheta": 0.01655755192041397,
      "rmse_dx": 0.005124736577272415,
      "rmse_dy": 0.003470171708613634,
      "rmse_mean": 0.008384153246879578,
      "rotation_flip": 0.008460236713290215,
      "sparse_tokens": 32089.0,
      "step": 5785,
      "turn_loss": 0.07364437729120255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.268816205166326,
      "grad_norm": 0.3973372280597687,
      "learning_rate": 5.363289853613054e-06,
      "loss": 0.1164,
      "mae_dtheta": 0.012065969407558441,
      "mae_dx": 0.0020184379536658525,
      "mae_dy": 0.002802658826112747,
      "pose_mae_dtheta": 0.08137337118387222,
      "pose_mae_dx": 0.02827262505888939,
      "pose_mae_dy": 0.03499080240726471,
      "pose_rmse_dtheta": 0.1901051253080368,
      "pose_rmse_dx": 0.07552389055490494,
      "pose_rmse_dy": 0.0788482129573822,
      "pose_rmse_mean": 0.11482574790716171,
      "rmse_dtheta": 0.02259882166981697,
      "rmse_dx": 0.006908650975674391,
      "rmse_dy": 0.005790869705379009,
      "rmse_mean": 0.011766115203499794,
      "rotation_flip": 0.0023380094207823277,
      "sparse_tokens": 32073.0,
      "step": 5786,
      "turn_loss": 0.09347623586654663,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.26886266493216876,
      "grad_norm": 0.3726094365119934,
      "learning_rate": 5.361971116530899e-06,
      "loss": 0.114,
      "mae_dtheta": 0.02061464823782444,
      "mae_dx": 0.007221569307148457,
      "mae_dy": 0.0032618953846395016,
      "pose_mae_dtheta": 0.1263679414987564,
      "pose_mae_dx": 0.06282126903533936,
      "pose_mae_dy": 0.03574325889348984,
      "pose_rmse_dtheta": 0.24808889627456665,
      "pose_rmse_dx": 0.16588270664215088,
      "pose_rmse_dy": 0.08411659300327301,
      "pose_rmse_mean": 0.16602939367294312,
      "rmse_dtheta": 0.037936195731163025,
      "rmse_dx": 0.018000472337007523,
      "rmse_dy": 0.007015685085207224,
      "rmse_mean": 0.020984118804335594,
      "rotation_flip": 0.016393441706895828,
      "sparse_tokens": 13696.0,
      "step": 5787,
      "turn_loss": 0.178101047873497,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.26890912469801154,
      "grad_norm": 0.6935122609138489,
      "learning_rate": 5.36065235413591e-06,
      "loss": 0.1622,
      "mae_dtheta": 0.0365862101316452,
      "mae_dx": 0.010649471543729305,
      "mae_dy": 0.006071222480386496,
      "pose_mae_dtheta": 0.29997381567955017,
      "pose_mae_dx": 0.0846748873591423,
      "pose_mae_dy": 0.08902312070131302,
      "pose_rmse_dtheta": 0.4910207688808441,
      "pose_rmse_dx": 0.19618971645832062,
      "pose_rmse_dy": 0.16279222071170807,
      "pose_rmse_mean": 0.28333425521850586,
      "rmse_dtheta": 0.05488764867186546,
      "rmse_dx": 0.022708971053361893,
      "rmse_dy": 0.011328954249620438,
      "rmse_mean": 0.029641857370734215,
      "rotation_flip": 0.006677796132862568,
      "sparse_tokens": 10285.0,
      "step": 5788,
      "turn_loss": 0.30949509143829346,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.2689555844638543,
      "grad_norm": 0.6066628694534302,
      "learning_rate": 5.359333566520309e-06,
      "loss": 0.1036,
      "mae_dtheta": 0.027091046795248985,
      "mae_dx": 0.012001759372651577,
      "mae_dy": 0.0031406094785779715,
      "pose_mae_dtheta": 0.19312259554862976,
      "pose_mae_dx": 0.08002247661352158,
      "pose_mae_dy": 0.04217391461133957,
      "pose_rmse_dtheta": 0.35166922211647034,
      "pose_rmse_dx": 0.21484686434268951,
      "pose_rmse_dy": 0.13189050555229187,
      "pose_rmse_mean": 0.23280219733715057,
      "rmse_dtheta": 0.04569797217845917,
      "rmse_dx": 0.025692353025078773,
      "rmse_dy": 0.007055697496980429,
      "rmse_mean": 0.02614867500960827,
      "rotation_flip": 0.010169491171836853,
      "sparse_tokens": 4842.0,
      "step": 5789,
      "turn_loss": 0.2700960636138916,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.2690020442296971,
      "grad_norm": 0.4759599268436432,
      "learning_rate": 5.358014753776318e-06,
      "loss": 0.0957,
      "mae_dtheta": 0.053617075085639954,
      "mae_dx": 0.010938815772533417,
      "mae_dy": 0.003183261724188924,
      "pose_mae_dtheta": 0.4318186640739441,
      "pose_mae_dx": 0.09312733262777328,
      "pose_mae_dy": 0.05077643692493439,
      "pose_rmse_dtheta": 0.7011315822601318,
      "pose_rmse_dx": 0.19256898760795593,
      "pose_rmse_dy": 0.12300165742635727,
      "pose_rmse_mean": 0.33890077471733093,
      "rmse_dtheta": 0.07009728997945786,
      "rmse_dx": 0.02270209603011608,
      "rmse_dy": 0.006876408588141203,
      "rmse_mean": 0.03322526812553406,
      "rotation_flip": 0.01689189113676548,
      "sparse_tokens": 3681.0,
      "step": 5790,
      "turn_loss": 0.34908536076545715,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.26904850399553987,
      "grad_norm": 0.5164792537689209,
      "learning_rate": 5.356695915996162e-06,
      "loss": 0.1052,
      "mae_dtheta": 0.010243795812129974,
      "mae_dx": 0.001856049057096243,
      "mae_dy": 0.0024552945978939533,
      "pose_mae_dtheta": 0.07144854217767715,
      "pose_mae_dx": 0.025296971201896667,
      "pose_mae_dy": 0.027678443118929863,
      "pose_rmse_dtheta": 0.17916131019592285,
      "pose_rmse_dx": 0.06735698878765106,
      "pose_rmse_dy": 0.06206957995891571,
      "pose_rmse_mean": 0.10286262631416321,
      "rmse_dtheta": 0.022817781195044518,
      "rmse_dx": 0.005672994069755077,
      "rmse_dy": 0.005537423770874739,
      "rmse_mean": 0.011342733167111874,
      "rotation_flip": 0.003968254197388887,
      "sparse_tokens": 32073.0,
      "step": 5791,
      "turn_loss": 0.07953324913978577,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.26909496376138264,
      "grad_norm": 0.5587002038955688,
      "learning_rate": 5.3553770532720705e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.03798476979136467,
      "mae_dx": 0.008271661587059498,
      "mae_dy": 0.006528342142701149,
      "pose_mae_dtheta": 0.27872833609580994,
      "pose_mae_dx": 0.06219637393951416,
      "pose_mae_dy": 0.06435423344373703,
      "pose_rmse_dtheta": 0.49304482340812683,
      "pose_rmse_dx": 0.1367294043302536,
      "pose_rmse_dy": 0.15188919007778168,
      "pose_rmse_mean": 0.2605544924736023,
      "rmse_dtheta": 0.05610819160938263,
      "rmse_dx": 0.01735067181289196,
      "rmse_dy": 0.014695573598146439,
      "rmse_mean": 0.029384812340140343,
      "rotation_flip": 0.01634320802986622,
      "sparse_tokens": 15656.0,
      "step": 5792,
      "turn_loss": 0.3092135190963745,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.2691414235272254,
      "grad_norm": 0.5689598917961121,
      "learning_rate": 5.354058165696271e-06,
      "loss": 0.1215,
      "mae_dtheta": 0.02643846906721592,
      "mae_dx": 0.006559664383530617,
      "mae_dy": 0.00287370546720922,
      "pose_mae_dtheta": 0.17676721513271332,
      "pose_mae_dx": 0.05192412808537483,
      "pose_mae_dy": 0.024507438763976097,
      "pose_rmse_dtheta": 0.38776877522468567,
      "pose_rmse_dx": 0.1205129474401474,
      "pose_rmse_dy": 0.05454595759510994,
      "pose_rmse_mean": 0.1876092255115509,
      "rmse_dtheta": 0.048127517104148865,
      "rmse_dx": 0.015627935528755188,
      "rmse_dy": 0.008052876219153404,
      "rmse_mean": 0.023936111479997635,
      "rotation_flip": 0.011928429827094078,
      "sparse_tokens": 9289.0,
      "step": 5793,
      "turn_loss": 0.22608457505702972,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 12315.0,
      "epoch": 0.2691878832930682,
      "grad_norm": 0.4980863630771637,
      "learning_rate": 5.352739253360993e-06,
      "loss": 0.1147,
      "mae_dtheta": 0.04743964970111847,
      "mae_dx": 0.010508736595511436,
      "mae_dy": 0.004497875925153494,
      "pose_mae_dtheta": 0.4419749081134796,
      "pose_mae_dx": 0.08949960023164749,
      "pose_mae_dy": 0.046950723975896835,
      "pose_rmse_dtheta": 0.7238140106201172,
      "pose_rmse_dx": 0.19416703283786774,
      "pose_rmse_dy": 0.12266240268945694,
      "pose_rmse_mean": 0.3468811511993408,
      "rmse_dtheta": 0.06825778633356094,
      "rmse_dx": 0.02188803441822529,
      "rmse_dy": 0.010570124723017216,
      "rmse_mean": 0.03357198089361191,
      "rotation_flip": 0.010835913009941578,
      "sparse_tokens": 9950.0,
      "step": 5794,
      "turn_loss": 0.33529555797576904,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.269234343058911,
      "grad_norm": 0.6527058482170105,
      "learning_rate": 5.351420316358471e-06,
      "loss": 0.1018,
      "mae_dtheta": 0.007528004702180624,
      "mae_dx": 0.0017684007761999965,
      "mae_dy": 0.0013941738288849592,
      "pose_mae_dtheta": 0.054705943912267685,
      "pose_mae_dx": 0.01915346086025238,
      "pose_mae_dy": 0.01988779939711094,
      "pose_rmse_dtheta": 0.1443501114845276,
      "pose_rmse_dx": 0.055413831025362015,
      "pose_rmse_dy": 0.049335986375808716,
      "pose_rmse_mean": 0.08303330838680267,
      "rmse_dtheta": 0.018749559298157692,
      "rmse_dx": 0.00617543188855052,
      "rmse_dy": 0.0029819649644196033,
      "rmse_mean": 0.009302319027483463,
      "rotation_flip": 0.005293806083500385,
      "sparse_tokens": 32105.0,
      "step": 5795,
      "turn_loss": 0.06308922916650772,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.26928080282475375,
      "grad_norm": 0.5103870630264282,
      "learning_rate": 5.3501013547809376e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.03385581448674202,
      "mae_dx": 0.011886660940945148,
      "mae_dy": 0.0075233094394207,
      "pose_mae_dtheta": 0.25824061036109924,
      "pose_mae_dx": 0.11053457856178284,
      "pose_mae_dy": 0.07321371883153915,
      "pose_rmse_dtheta": 0.4153258502483368,
      "pose_rmse_dx": 0.23510754108428955,
      "pose_rmse_dy": 0.15630404651165009,
      "pose_rmse_mean": 0.26891249418258667,
      "rmse_dtheta": 0.046755436807870865,
      "rmse_dx": 0.023331690579652786,
      "rmse_dy": 0.014670412056148052,
      "rmse_mean": 0.028252512216567993,
      "rotation_flip": 0.011713030748069286,
      "sparse_tokens": 10922.0,
      "step": 5796,
      "turn_loss": 0.33544614911079407,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.26932726259059653,
      "grad_norm": 0.8244643807411194,
      "learning_rate": 5.348782368720627e-06,
      "loss": 0.288,
      "mae_dtheta": 0.04195679724216461,
      "mae_dx": 0.01377997174859047,
      "mae_dy": 0.016728442162275314,
      "pose_mae_dtheta": 0.33638906478881836,
      "pose_mae_dx": 0.11845200508832932,
      "pose_mae_dy": 0.1431523859500885,
      "pose_rmse_dtheta": 0.6200206279754639,
      "pose_rmse_dx": 0.23230718076229095,
      "pose_rmse_dy": 0.3587381839752197,
      "pose_rmse_mean": 0.4036886692047119,
      "rmse_dtheta": 0.06559445708990097,
      "rmse_dx": 0.026817481964826584,
      "rmse_dy": 0.03532653674483299,
      "rmse_mean": 0.042579494416713715,
      "rotation_flip": 0.017167381942272186,
      "sparse_tokens": 8081.0,
      "step": 5797,
      "turn_loss": 0.5238845348358154,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2693737223564393,
      "grad_norm": 0.7211471199989319,
      "learning_rate": 5.347463358269779e-06,
      "loss": 0.1484,
      "mae_dtheta": 0.007021857425570488,
      "mae_dx": 0.002282549161463976,
      "mae_dy": 0.0003741710970643908,
      "pose_mae_dtheta": 0.04897313192486763,
      "pose_mae_dx": 0.021181970834732056,
      "pose_mae_dy": 0.005124801304191351,
      "pose_rmse_dtheta": 0.22822849452495575,
      "pose_rmse_dx": 0.10591106861829758,
      "pose_rmse_dy": 0.022884665057063103,
      "pose_rmse_mean": 0.11900807917118073,
      "rmse_dtheta": 0.027481546625494957,
      "rmse_dx": 0.01027472410351038,
      "rmse_dy": 0.0011964060831815004,
      "rmse_mean": 0.012984226457774639,
      "rotation_flip": 0.0021443888545036316,
      "sparse_tokens": 32153.0,
      "step": 5798,
      "turn_loss": 0.05046992748975754,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.2694201821222821,
      "grad_norm": 0.720511794090271,
      "learning_rate": 5.3461443235206325e-06,
      "loss": 0.1469,
      "mae_dtheta": 0.03369680047035217,
      "mae_dx": 0.01229217927902937,
      "mae_dy": 0.0062041692435741425,
      "pose_mae_dtheta": 0.24533434212207794,
      "pose_mae_dx": 0.10061201453208923,
      "pose_mae_dy": 0.06424777954816818,
      "pose_rmse_dtheta": 0.4594913423061371,
      "pose_rmse_dx": 0.22160089015960693,
      "pose_rmse_dy": 0.1418038308620453,
      "pose_rmse_mean": 0.2742987275123596,
      "rmse_dtheta": 0.05133403092622757,
      "rmse_dx": 0.024905690923333168,
      "rmse_dy": 0.012113080359995365,
      "rmse_mean": 0.029450934380292892,
      "rotation_flip": 0.007072135806083679,
      "sparse_tokens": 11713.0,
      "step": 5799,
      "turn_loss": 0.29658541083335876,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.26946664188812486,
      "grad_norm": 0.4028211832046509,
      "learning_rate": 5.344825264565426e-06,
      "loss": 0.0776,
      "mae_dtheta": 0.007134716957807541,
      "mae_dx": 0.0012377094244584441,
      "mae_dy": 0.0012331213802099228,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.40282124280929565,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.07077026367188,
      "model/head/act_norm_mean": 124.09110637626263,
      "model/head/act_norm_min": 64.07747650146484,
      "model/head/act_over_embed": 85.2765700610094,
      "model/head/grad_frac": 0.11125896126031876,
      "model/head/grad_norm": 0.044817473739385605,
      "model/head/grad_zero_frac": 0.00018465216271579266,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6914210464015151,
      "model/head/update_ratio": 0.0007660778355784714,
      "model/head/weight_delta": 8.815258979797363,
      "model/head/weight_delta_rel": 0.15464575588703156,
      "model/head/weight_norm": 58.502506256103516,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4207157790660858,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4206411158784907,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4205568730831146,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2890685129358715,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08845140039920807,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03563010320067406,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5340841090425532,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011517915409058332,
      "model/modality_embedder.encoders.pose/weight_delta": 2.870558023452759,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09379007667303085,
      "model/modality_embedder.encoders.pose/weight_norm": 30.934505462646484,
      "model/modality_embedder/grad_frac": 0.08845140039920807,
      "model/modality_embedder/grad_norm": 0.03563010320067406,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5340841090425532,
      "model/modality_embedder/update_ratio": 0.0011517915409058332,
      "model/modality_embedder/weight_delta": 2.870558023452759,
      "model/modality_embedder/weight_delta_rel": 0.09379007667303085,
      "model/modality_embedder/weight_norm": 30.934505462646484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.94445037841797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.018573633156965,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.057210922241211,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.192998028282137,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10320432484149933,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.041572894901037216,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014927127631381154,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.231269598007202,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08130881190299988,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.85056495666504,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.3650131225586,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.06208664021164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.189759254455566,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.910109936252802,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09451962262392044,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03807451203465462,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012868259800598025,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.8275675773620605,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09794914722442627,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.58792495727539,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.84993743896484,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.991018819143818,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.278310775756836,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.235690188562575,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09796112030744553,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03946081921458244,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001291752210818231,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.04803466796875,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10234729945659637,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.548288345336914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.8228530883789,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.70335046897547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.40285587310791,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.412420529428367,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10230576992034912,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04121093824505806,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013824360212311149,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.6033077239990234,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08896870166063309,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.81037712097168,
      "model/normalizer/grad_frac": 0.4240495562553406,
      "model/normalizer/grad_norm": 0.17081616818904877,
      "model/normalizer/grad_zero_frac": 0.00016426164074800909,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021772871259599924,
      "model/normalizer/weight_delta": 5.514893054962158,
      "model/normalizer/weight_delta_rel": 0.07102862745523453,
      "model/normalizer/weight_norm": 78.45367431640625,
      "pose_mae_dtheta": 0.05020379275083542,
      "pose_mae_dx": 0.013148841448128223,
      "pose_mae_dy": 0.015260713174939156,
      "pose_rmse_dtheta": 0.17713770270347595,
      "pose_rmse_dx": 0.033095117658376694,
      "pose_rmse_dy": 0.03913810849189758,
      "pose_rmse_mean": 0.08312364667654037,
      "rmse_dtheta": 0.02057628147304058,
      "rmse_dx": 0.003621256211772561,
      "rmse_dy": 0.002683884697034955,
      "rmse_mean": 0.008960474282503128,
      "rotation_flip": 0.0035363456699997187,
      "sparse_tokens": 32201.0,
      "step": 5800,
      "turn_loss": 0.04783578962087631,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.26946664188812486,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31005433201789856,
      "eval_objectnav_nopose_mae_dtheta": 0.040581051260232925,
      "eval_objectnav_nopose_mae_dx": 0.013388277031481266,
      "eval_objectnav_nopose_mae_dy": 0.005430123768746853,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3270533084869385,
      "eval_objectnav_nopose_pose_mae_dx": 0.10807008296251297,
      "eval_objectnav_nopose_pose_mae_dy": 0.06014666333794594,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5493802428245544,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23768337070941925,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14295393228530884,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3100058436393738,
      "eval_objectnav_nopose_rmse_dtheta": 0.05842209979891777,
      "eval_objectnav_nopose_rmse_dx": 0.026251258328557014,
      "eval_objectnav_nopose_rmse_dy": 0.01133244950324297,
      "eval_objectnav_nopose_rmse_mean": 0.03200193867087364,
      "eval_objectnav_nopose_rotation_flip": 0.018365204334259033,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31005433201789856,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 5800
    },
    {
      "epoch": 0.26946664188812486,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2774788439273834,
      "eval_objectnav_pose_mae_dtheta": 0.03663349896669388,
      "eval_objectnav_pose_mae_dx": 0.011750834062695503,
      "eval_objectnav_pose_mae_dy": 0.0051458654925227165,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2791416645050049,
      "eval_objectnav_pose_pose_mae_dx": 0.0942557156085968,
      "eval_objectnav_pose_pose_mae_dy": 0.053553931415081024,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4821784794330597,
      "eval_objectnav_pose_pose_rmse_dx": 0.2154962569475174,
      "eval_objectnav_pose_pose_rmse_dy": 0.13164319097995758,
      "eval_objectnav_pose_pose_rmse_mean": 0.2764393091201782,
      "eval_objectnav_pose_rmse_dtheta": 0.054311469197273254,
      "eval_objectnav_pose_rmse_dx": 0.02404898777604103,
      "eval_objectnav_pose_rmse_dy": 0.011127176694571972,
      "eval_objectnav_pose_rmse_mean": 0.02982920967042446,
      "eval_objectnav_pose_rotation_flip": 0.01610073633491993,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2774788439273834,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 5800
    },
    {
      "epoch": 0.26946664188812486,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09558311104774475,
      "eval_pointnav_mae_dtheta": 0.010972385294735432,
      "eval_pointnav_mae_dx": 0.002652087016031146,
      "eval_pointnav_mae_dy": 0.002578767715021968,
      "eval_pointnav_pose_mae_dtheta": 0.07596246153116226,
      "eval_pointnav_pose_mae_dx": 0.029862334951758385,
      "eval_pointnav_pose_mae_dy": 0.02694925107061863,
      "eval_pointnav_pose_rmse_dtheta": 0.20975685119628906,
      "eval_pointnav_pose_rmse_dx": 0.08911656588315964,
      "eval_pointnav_pose_rmse_dy": 0.07459774613380432,
      "eval_pointnav_pose_rmse_mean": 0.1244903951883316,
      "eval_pointnav_rmse_dtheta": 0.02623084932565689,
      "eval_pointnav_rmse_dx": 0.008151588030159473,
      "eval_pointnav_rmse_dy": 0.0067538050934672356,
      "eval_pointnav_rmse_mean": 0.013712081126868725,
      "eval_pointnav_rotation_flip": 0.005910777486860752,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09558311104774475,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 5800
    },
    {
      "epoch": 0.26946664188812486,
      "eval_loss": 0.22770542899767557,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31005433201789856,
      "eval_objectnav_nopose_mae_dtheta": 0.040581051260232925,
      "eval_objectnav_nopose_mae_dx": 0.013388277031481266,
      "eval_objectnav_nopose_mae_dy": 0.005430123768746853,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3270533084869385,
      "eval_objectnav_nopose_pose_mae_dx": 0.10807008296251297,
      "eval_objectnav_nopose_pose_mae_dy": 0.06014666333794594,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5493802428245544,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23768337070941925,
      "eval_objectnav_nopose_pose_rmse_dy": 0.14295393228530884,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3100058436393738,
      "eval_objectnav_nopose_rmse_dtheta": 0.05842209979891777,
      "eval_objectnav_nopose_rmse_dx": 0.026251258328557014,
      "eval_objectnav_nopose_rmse_dy": 0.01133244950324297,
      "eval_objectnav_nopose_rmse_mean": 0.03200193867087364,
      "eval_objectnav_nopose_rotation_flip": 0.018365204334259033,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31005433201789856,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2774788439273834,
      "eval_objectnav_pose_mae_dtheta": 0.03663349896669388,
      "eval_objectnav_pose_mae_dx": 0.011750834062695503,
      "eval_objectnav_pose_mae_dy": 0.0051458654925227165,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2791416645050049,
      "eval_objectnav_pose_pose_mae_dx": 0.0942557156085968,
      "eval_objectnav_pose_pose_mae_dy": 0.053553931415081024,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4821784794330597,
      "eval_objectnav_pose_pose_rmse_dx": 0.2154962569475174,
      "eval_objectnav_pose_pose_rmse_dy": 0.13164319097995758,
      "eval_objectnav_pose_pose_rmse_mean": 0.2764393091201782,
      "eval_objectnav_pose_rmse_dtheta": 0.054311469197273254,
      "eval_objectnav_pose_rmse_dx": 0.02404898777604103,
      "eval_objectnav_pose_rmse_dy": 0.011127176694571972,
      "eval_objectnav_pose_rmse_mean": 0.02982920967042446,
      "eval_objectnav_pose_rotation_flip": 0.01610073633491993,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2774788439273834,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09558311104774475,
      "eval_pointnav_mae_dtheta": 0.010972385294735432,
      "eval_pointnav_mae_dx": 0.002652087016031146,
      "eval_pointnav_mae_dy": 0.002578767715021968,
      "eval_pointnav_pose_mae_dtheta": 0.07596246153116226,
      "eval_pointnav_pose_mae_dx": 0.029862334951758385,
      "eval_pointnav_pose_mae_dy": 0.02694925107061863,
      "eval_pointnav_pose_rmse_dtheta": 0.20975685119628906,
      "eval_pointnav_pose_rmse_dx": 0.08911656588315964,
      "eval_pointnav_pose_rmse_dy": 0.07459774613380432,
      "eval_pointnav_pose_rmse_mean": 0.1244903951883316,
      "eval_pointnav_rmse_dtheta": 0.02623084932565689,
      "eval_pointnav_rmse_dx": 0.008151588030159473,
      "eval_pointnav_rmse_dy": 0.0067538050934672356,
      "eval_pointnav_rmse_mean": 0.013712081126868725,
      "eval_pointnav_rotation_flip": 0.005910777486860752,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09558311104774475,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 5800
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.2695131016539677,
      "grad_norm": 0.660839319229126,
      "learning_rate": 5.343506181496405e-06,
      "loss": 0.19,
      "mae_dtheta": 0.03794122859835625,
      "mae_dx": 0.004288165830075741,
      "mae_dy": 0.004776199348270893,
      "pose_mae_dtheta": 0.290180504322052,
      "pose_mae_dx": 0.047931525856256485,
      "pose_mae_dy": 0.03718629479408264,
      "pose_rmse_dtheta": 0.5398645401000977,
      "pose_rmse_dx": 0.09845167398452759,
      "pose_rmse_dy": 0.08595945686101913,
      "pose_rmse_mean": 0.24142521619796753,
      "rmse_dtheta": 0.059408172965049744,
      "rmse_dx": 0.009650188498198986,
      "rmse_dy": 0.009818945080041885,
      "rmse_mean": 0.026292433962225914,
      "rotation_flip": 0.01655629090964794,
      "sparse_tokens": 5430.0,
      "step": 5801,
      "turn_loss": 0.24669595062732697,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.26955956141981047,
      "grad_norm": 0.5695136785507202,
      "learning_rate": 5.342187074405812e-06,
      "loss": 0.1006,
      "mae_dtheta": 0.012127852067351341,
      "mae_dx": 0.0018133175326511264,
      "mae_dy": 0.0028077077586203814,
      "pose_mae_dtheta": 0.08695604652166367,
      "pose_mae_dx": 0.025330431759357452,
      "pose_mae_dy": 0.031011853367090225,
      "pose_rmse_dtheta": 0.23414364457130432,
      "pose_rmse_dx": 0.06364195793867111,
      "pose_rmse_dy": 0.07199995964765549,
      "pose_rmse_mean": 0.12326186150312424,
      "rmse_dtheta": 0.025976555421948433,
      "rmse_dx": 0.00564152654260397,
      "rmse_dy": 0.005712385755032301,
      "rmse_mean": 0.012443489395081997,
      "rotation_flip": 0.006425702944397926,
      "sparse_tokens": 32057.0,
      "step": 5802,
      "turn_loss": 0.08561745285987854,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.26960602118565324,
      "grad_norm": 0.7741819024085999,
      "learning_rate": 5.340867943385895e-06,
      "loss": 0.2879,
      "mae_dtheta": 0.036484602838754654,
      "mae_dx": 0.009069417603313923,
      "mae_dy": 0.007896732538938522,
      "pose_mae_dtheta": 0.2769149839878082,
      "pose_mae_dx": 0.06232297793030739,
      "pose_mae_dy": 0.06671517342329025,
      "pose_rmse_dtheta": 0.46138936281204224,
      "pose_rmse_dx": 0.16895966231822968,
      "pose_rmse_dy": 0.2017698884010315,
      "pose_rmse_mean": 0.27737298607826233,
      "rmse_dtheta": 0.054218027740716934,
      "rmse_dx": 0.01962268352508545,
      "rmse_dy": 0.020303942263126373,
      "rmse_mean": 0.031381551176309586,
      "rotation_flip": 0.01799100451171398,
      "sparse_tokens": 9929.0,
      "step": 5803,
      "turn_loss": 0.31275469064712524,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.269652480951496,
      "grad_norm": 0.8957973122596741,
      "learning_rate": 5.339548788528897e-06,
      "loss": 0.2596,
      "mae_dtheta": 0.04544822499155998,
      "mae_dx": 0.01259028259664774,
      "mae_dy": 0.004781016148626804,
      "pose_mae_dtheta": 0.3818681538105011,
      "pose_mae_dx": 0.09633444249629974,
      "pose_mae_dy": 0.03689046949148178,
      "pose_rmse_dtheta": 0.6489421129226685,
      "pose_rmse_dx": 0.21126464009284973,
      "pose_rmse_dy": 0.08718464523553848,
      "pose_rmse_mean": 0.3157971501350403,
      "rmse_dtheta": 0.06629301607608795,
      "rmse_dx": 0.02419508993625641,
      "rmse_dy": 0.010354348458349705,
      "rmse_mean": 0.0336141511797905,
      "rotation_flip": 0.023225806653499603,
      "sparse_tokens": 12755.0,
      "step": 5804,
      "turn_loss": 0.3206729292869568,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2696989407173388,
      "grad_norm": 0.5853915810585022,
      "learning_rate": 5.338229609927072e-06,
      "loss": 0.0984,
      "mae_dtheta": 0.010375402867794037,
      "mae_dx": 0.0032558748498559,
      "mae_dy": 0.0037750503979623318,
      "pose_mae_dtheta": 0.08011473715305328,
      "pose_mae_dx": 0.03517000004649162,
      "pose_mae_dy": 0.033404652029275894,
      "pose_rmse_dtheta": 0.19288936257362366,
      "pose_rmse_dx": 0.09503120183944702,
      "pose_rmse_dy": 0.0777464509010315,
      "pose_rmse_mean": 0.12188901007175446,
      "rmse_dtheta": 0.024052025750279427,
      "rmse_dx": 0.008225910365581512,
      "rmse_dy": 0.009115418419241905,
      "rmse_mean": 0.01379778515547514,
      "rotation_flip": 0.010761945508420467,
      "sparse_tokens": 32105.0,
      "step": 5805,
      "turn_loss": 0.10643745213747025,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2697454004831816,
      "grad_norm": 0.6072820425033569,
      "learning_rate": 5.336910407672668e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.009142261929810047,
      "mae_dx": 0.001828793785534799,
      "mae_dy": 0.0016201080288738012,
      "pose_mae_dtheta": 0.06214694678783417,
      "pose_mae_dx": 0.021124929189682007,
      "pose_mae_dy": 0.020397508516907692,
      "pose_rmse_dtheta": 0.17739605903625488,
      "pose_rmse_dx": 0.06123880296945572,
      "pose_rmse_dy": 0.053177714347839355,
      "pose_rmse_mean": 0.09727086126804352,
      "rmse_dtheta": 0.022535735741257668,
      "rmse_dx": 0.006379931233823299,
      "rmse_dy": 0.005346702411770821,
      "rmse_mean": 0.011420789174735546,
      "rotation_flip": 0.0024968788493424654,
      "sparse_tokens": 32137.0,
      "step": 5806,
      "turn_loss": 0.07300812005996704,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37198.0,
      "epoch": 0.26979186024902435,
      "grad_norm": 0.5180355906486511,
      "learning_rate": 5.335591181857939e-06,
      "loss": 0.1561,
      "mae_dtheta": 0.04376405477523804,
      "mae_dx": 0.012520925141870975,
      "mae_dy": 0.007886916399002075,
      "pose_mae_dtheta": 0.34533023834228516,
      "pose_mae_dx": 0.09936936944723129,
      "pose_mae_dy": 0.08920212835073471,
      "pose_rmse_dtheta": 0.5729604363441467,
      "pose_rmse_dx": 0.21113678812980652,
      "pose_rmse_dy": 0.19707569479942322,
      "pose_rmse_mean": 0.3270576596260071,
      "rmse_dtheta": 0.061918437480926514,
      "rmse_dx": 0.024975188076496124,
      "rmse_dy": 0.015700848773121834,
      "rmse_mean": 0.034198157489299774,
      "rotation_flip": 0.015774648636579514,
      "sparse_tokens": 29698.0,
      "step": 5807,
      "turn_loss": 0.3187306523323059,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.26983832001486713,
      "grad_norm": 0.9803187251091003,
      "learning_rate": 5.334271932575137e-06,
      "loss": 0.1351,
      "mae_dtheta": 0.040880486369132996,
      "mae_dx": 0.013033757917582989,
      "mae_dy": 0.00947711430490017,
      "pose_mae_dtheta": 0.33164840936660767,
      "pose_mae_dx": 0.08419995754957199,
      "pose_mae_dy": 0.10717162489891052,
      "pose_rmse_dtheta": 0.6104760766029358,
      "pose_rmse_dx": 0.17279194295406342,
      "pose_rmse_dy": 0.271553099155426,
      "pose_rmse_mean": 0.3516070544719696,
      "rmse_dtheta": 0.05993888899683952,
      "rmse_dx": 0.024929586797952652,
      "rmse_dy": 0.01924843341112137,
      "rmse_mean": 0.03470563888549805,
      "rotation_flip": 0.0189701896160841,
      "sparse_tokens": 6255.0,
      "step": 5808,
      "turn_loss": 0.34229904413223267,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2698847797807099,
      "grad_norm": 0.43058615922927856,
      "learning_rate": 5.33295265991652e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.012236476875841618,
      "mae_dx": 0.003058435395359993,
      "mae_dy": 0.0035468246787786484,
      "pose_mae_dtheta": 0.08914093673229218,
      "pose_mae_dx": 0.03846503794193268,
      "pose_mae_dy": 0.04284721612930298,
      "pose_rmse_dtheta": 0.20888055860996246,
      "pose_rmse_dx": 0.11060252785682678,
      "pose_rmse_dy": 0.11077789962291718,
      "pose_rmse_mean": 0.14342033863067627,
      "rmse_dtheta": 0.025701357051730156,
      "rmse_dx": 0.010622594505548477,
      "rmse_dy": 0.009035499766469002,
      "rmse_mean": 0.015119816176593304,
      "rotation_flip": 0.0044554453343153,
      "sparse_tokens": 32057.0,
      "step": 5809,
      "turn_loss": 0.11416643112897873,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2699312395465527,
      "grad_norm": 0.45867395401000977,
      "learning_rate": 5.3316333639743445e-06,
      "loss": 0.0926,
      "mae_dtheta": 0.007645961828529835,
      "mae_dx": 0.0013502311194315553,
      "mae_dy": 0.0019401611061766744,
      "pose_mae_dtheta": 0.053695958107709885,
      "pose_mae_dx": 0.018541039898991585,
      "pose_mae_dy": 0.022139938548207283,
      "pose_rmse_dtheta": 0.13813087344169617,
      "pose_rmse_dx": 0.04991936683654785,
      "pose_rmse_dy": 0.06455331295728683,
      "pose_rmse_mean": 0.08420118689537048,
      "rmse_dtheta": 0.018102223053574562,
      "rmse_dx": 0.0041527170687913895,
      "rmse_dy": 0.004601765889674425,
      "rmse_mean": 0.00895223580300808,
      "rotation_flip": 0.002254283055663109,
      "sparse_tokens": 32089.0,
      "step": 5810,
      "turn_loss": 0.0688692182302475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.26997769931239546,
      "grad_norm": 0.5101132392883301,
      "learning_rate": 5.330314044840871e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.035797033458948135,
      "mae_dx": 0.013663697056472301,
      "mae_dy": 0.003186854301020503,
      "pose_mae_dtheta": 0.24589894711971283,
      "pose_mae_dx": 0.10745950043201447,
      "pose_mae_dy": 0.03490971028804779,
      "pose_rmse_dtheta": 0.47058218717575073,
      "pose_rmse_dx": 0.24854791164398193,
      "pose_rmse_dy": 0.07591838389635086,
      "pose_rmse_mean": 0.2650161683559418,
      "rmse_dtheta": 0.05550380051136017,
      "rmse_dx": 0.026840664446353912,
      "rmse_dy": 0.006176499184221029,
      "rmse_mean": 0.02950698882341385,
      "rotation_flip": 0.019503546878695488,
      "sparse_tokens": 10238.0,
      "step": 5811,
      "turn_loss": 0.2313186228275299,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.27002415907823824,
      "grad_norm": 0.6255702972412109,
      "learning_rate": 5.3289947026083575e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.03510543704032898,
      "mae_dx": 0.015565003268420696,
      "mae_dy": 0.005107660312205553,
      "pose_mae_dtheta": 0.2800219655036926,
      "pose_mae_dx": 0.13115154206752777,
      "pose_mae_dy": 0.050773367285728455,
      "pose_rmse_dtheta": 0.4764004349708557,
      "pose_rmse_dx": 0.2674410343170166,
      "pose_rmse_dy": 0.12684795260429382,
      "pose_rmse_mean": 0.29022979736328125,
      "rmse_dtheta": 0.05275364965200424,
      "rmse_dx": 0.029002917930483818,
      "rmse_dy": 0.01115475594997406,
      "rmse_mean": 0.030970443040132523,
      "rotation_flip": 0.012014787644147873,
      "sparse_tokens": 20859.0,
      "step": 5812,
      "turn_loss": 0.2526625096797943,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.270070618844081,
      "grad_norm": 0.6267522573471069,
      "learning_rate": 5.32767533736907e-06,
      "loss": 0.1927,
      "mae_dtheta": 0.013327028602361679,
      "mae_dx": 0.002000396139919758,
      "mae_dy": 0.0034150423016399145,
      "pose_mae_dtheta": 0.0873953253030777,
      "pose_mae_dx": 0.0317845456302166,
      "pose_mae_dy": 0.04134524241089821,
      "pose_rmse_dtheta": 0.22315502166748047,
      "pose_rmse_dx": 0.08314132690429688,
      "pose_rmse_dy": 0.11015862971544266,
      "pose_rmse_mean": 0.13881832361221313,
      "rmse_dtheta": 0.02774573676288128,
      "rmse_dx": 0.00579922366887331,
      "rmse_dy": 0.007689337246119976,
      "rmse_mean": 0.01374476682394743,
      "rotation_flip": 0.009725158102810383,
      "sparse_tokens": 32057.0,
      "step": 5813,
      "turn_loss": 0.10235266387462616,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2701170786099238,
      "grad_norm": 0.44425535202026367,
      "learning_rate": 5.326355949215268e-06,
      "loss": 0.0731,
      "mae_dtheta": 0.008485258556902409,
      "mae_dx": 0.0013860046165063977,
      "mae_dy": 0.0011532398639246821,
      "pose_mae_dtheta": 0.05946444347500801,
      "pose_mae_dx": 0.01433473825454712,
      "pose_mae_dy": 0.01361758355051279,
      "pose_rmse_dtheta": 0.2102549970149994,
      "pose_rmse_dx": 0.0370180644094944,
      "pose_rmse_dy": 0.038087423890829086,
      "pose_rmse_mean": 0.09512016177177429,
      "rmse_dtheta": 0.024884214624762535,
      "rmse_dx": 0.004176483955234289,
      "rmse_dy": 0.00294718099758029,
      "rmse_mean": 0.010669293813407421,
      "rotation_flip": 0.004437869880348444,
      "sparse_tokens": 32153.0,
      "step": 5814,
      "turn_loss": 0.05563899874687195,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.27016353837576657,
      "grad_norm": 0.6193003058433533,
      "learning_rate": 5.325036538239221e-06,
      "loss": 0.1759,
      "mae_dtheta": 0.03551856800913811,
      "mae_dx": 0.00931575708091259,
      "mae_dy": 0.008371967822313309,
      "pose_mae_dtheta": 0.26890915632247925,
      "pose_mae_dx": 0.06031358614563942,
      "pose_mae_dy": 0.10192674398422241,
      "pose_rmse_dtheta": 0.5071231722831726,
      "pose_rmse_dx": 0.11829009652137756,
      "pose_rmse_dy": 0.1911710798740387,
      "pose_rmse_mean": 0.2721948027610779,
      "rmse_dtheta": 0.05489888787269592,
      "rmse_dx": 0.020729489624500275,
      "rmse_dy": 0.013023880310356617,
      "rmse_mean": 0.02955075353384018,
      "rotation_flip": 0.009493670426309109,
      "sparse_tokens": 4918.0,
      "step": 5815,
      "turn_loss": 0.32971158623695374,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.27020999814160934,
      "grad_norm": 0.5187925696372986,
      "learning_rate": 5.323717104533193e-06,
      "loss": 0.0932,
      "mae_dtheta": 0.00780875701457262,
      "mae_dx": 0.001503022969700396,
      "mae_dy": 0.0017793248407542706,
      "pose_mae_dtheta": 0.05496785044670105,
      "pose_mae_dx": 0.021640339866280556,
      "pose_mae_dy": 0.02674584649503231,
      "pose_rmse_dtheta": 0.11896040290594101,
      "pose_rmse_dx": 0.06288541853427887,
      "pose_rmse_dy": 0.06690128892660141,
      "pose_rmse_mean": 0.08291570842266083,
      "rmse_dtheta": 0.016445696353912354,
      "rmse_dx": 0.005887681618332863,
      "rmse_dy": 0.003810014808550477,
      "rmse_mean": 0.008714464493095875,
      "rotation_flip": 0.003266639541834593,
      "sparse_tokens": 32089.0,
      "step": 5816,
      "turn_loss": 0.061619047075510025,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2702564579074521,
      "grad_norm": 0.7705566883087158,
      "learning_rate": 5.322397648189454e-06,
      "loss": 0.1736,
      "mae_dtheta": 0.005713787395507097,
      "mae_dx": 0.0010207127779722214,
      "mae_dy": 0.0011223681503906846,
      "pose_mae_dtheta": 0.04090721532702446,
      "pose_mae_dx": 0.012418178841471672,
      "pose_mae_dy": 0.01547846756875515,
      "pose_rmse_dtheta": 0.10411769151687622,
      "pose_rmse_dx": 0.03366849198937416,
      "pose_rmse_dy": 0.04369542375206947,
      "pose_rmse_mean": 0.060493867844343185,
      "rmse_dtheta": 0.014310386031866074,
      "rmse_dx": 0.0033363408874720335,
      "rmse_dy": 0.00277663953602314,
      "rmse_mean": 0.0068077887408435345,
      "rotation_flip": 0.0030800821259617805,
      "sparse_tokens": 32089.0,
      "step": 5817,
      "turn_loss": 0.049555107951164246,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.27030291767329495,
      "grad_norm": 0.9161712527275085,
      "learning_rate": 5.321078169300275e-06,
      "loss": 0.2109,
      "mae_dtheta": 0.04176703467965126,
      "mae_dx": 0.017242128029465675,
      "mae_dy": 0.007681912276893854,
      "pose_mae_dtheta": 0.3406785726547241,
      "pose_mae_dx": 0.14073045551776886,
      "pose_mae_dy": 0.09650640934705734,
      "pose_rmse_dtheta": 0.551865816116333,
      "pose_rmse_dx": 0.2799799144268036,
      "pose_rmse_dy": 0.209525004029274,
      "pose_rmse_mean": 0.3471235930919647,
      "rmse_dtheta": 0.06019943207502365,
      "rmse_dx": 0.030285567045211792,
      "rmse_dy": 0.014307214878499508,
      "rmse_mean": 0.03493073955178261,
      "rotation_flip": 0.009159034118056297,
      "sparse_tokens": 20732.0,
      "step": 5818,
      "turn_loss": 0.41041722893714905,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.27034937743913773,
      "grad_norm": 0.5860212445259094,
      "learning_rate": 5.319758667957929e-06,
      "loss": 0.1894,
      "mae_dtheta": 0.018670177087187767,
      "mae_dx": 0.010906023904681206,
      "mae_dy": 0.003650856204330921,
      "pose_mae_dtheta": 0.1264163851737976,
      "pose_mae_dx": 0.09294715523719788,
      "pose_mae_dy": 0.05375984311103821,
      "pose_rmse_dtheta": 0.23525384068489075,
      "pose_rmse_dx": 0.24254293739795685,
      "pose_rmse_dy": 0.12925729155540466,
      "pose_rmse_mean": 0.202351376414299,
      "rmse_dtheta": 0.03494102507829666,
      "rmse_dx": 0.02559235878288746,
      "rmse_dy": 0.007242264691740274,
      "rmse_mean": 0.022591881453990936,
      "rotation_flip": 0.004166666883975267,
      "sparse_tokens": 11414.0,
      "step": 5819,
      "turn_loss": 0.152018204331398,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2703958372049805,
      "grad_norm": 0.7354611754417419,
      "learning_rate": 5.318439144254685e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.011079085990786552,
      "mae_dx": 0.0027039337437599897,
      "mae_dy": 0.004438989330083132,
      "pose_mae_dtheta": 0.08095947653055191,
      "pose_mae_dx": 0.03517220541834831,
      "pose_mae_dy": 0.04062976688146591,
      "pose_rmse_dtheta": 0.19391180574893951,
      "pose_rmse_dx": 0.10037902742624283,
      "pose_rmse_dy": 0.10650292038917542,
      "pose_rmse_mean": 0.13359792530536652,
      "rmse_dtheta": 0.023752771317958832,
      "rmse_dx": 0.006898475345224142,
      "rmse_dy": 0.010798752307891846,
      "rmse_mean": 0.013816667720675468,
      "rotation_flip": 0.004433696158230305,
      "sparse_tokens": 32089.0,
      "step": 5820,
      "turn_loss": 0.12048027664422989,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.2704422969708233,
      "grad_norm": 0.48684966564178467,
      "learning_rate": 5.317119598282823e-06,
      "loss": 0.1448,
      "mae_dtheta": 0.03380970284342766,
      "mae_dx": 0.008762269280850887,
      "mae_dy": 0.005016039591282606,
      "pose_mae_dtheta": 0.2899923622608185,
      "pose_mae_dx": 0.0685664489865303,
      "pose_mae_dy": 0.08917874842882156,
      "pose_rmse_dtheta": 0.5010151267051697,
      "pose_rmse_dx": 0.13790470361709595,
      "pose_rmse_dy": 0.22138524055480957,
      "pose_rmse_mean": 0.28676837682724,
      "rmse_dtheta": 0.05221834406256676,
      "rmse_dx": 0.018394652754068375,
      "rmse_dy": 0.010163339786231518,
      "rmse_mean": 0.02692544460296631,
      "rotation_flip": 0.004385964944958687,
      "sparse_tokens": 6979.0,
      "step": 5821,
      "turn_loss": 0.19858253002166748,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.27048875673666606,
      "grad_norm": 0.5444228649139404,
      "learning_rate": 5.315800030134617e-06,
      "loss": 0.1952,
      "mae_dtheta": 0.00928698480129242,
      "mae_dx": 0.0014661330496892333,
      "mae_dy": 0.0013157492503523827,
      "pose_mae_dtheta": 0.0673975795507431,
      "pose_mae_dx": 0.015354647301137447,
      "pose_mae_dy": 0.01892179436981678,
      "pose_rmse_dtheta": 0.18064545094966888,
      "pose_rmse_dx": 0.0355071984231472,
      "pose_rmse_dy": 0.043446362018585205,
      "pose_rmse_mean": 0.08653301000595093,
      "rmse_dtheta": 0.021563000977039337,
      "rmse_dx": 0.004330670461058617,
      "rmse_dy": 0.002628762274980545,
      "rmse_mean": 0.009507478214800358,
      "rotation_flip": 0.002919707912951708,
      "sparse_tokens": 32105.0,
      "step": 5822,
      "turn_loss": 0.07795686274766922,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.27053521650250884,
      "grad_norm": 0.5638636350631714,
      "learning_rate": 5.314480439902345e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.012006668373942375,
      "mae_dx": 0.0021315014455467463,
      "mae_dy": 0.0034478148445487022,
      "pose_mae_dtheta": 0.08663756400346756,
      "pose_mae_dx": 0.030078180134296417,
      "pose_mae_dy": 0.030862988904118538,
      "pose_rmse_dtheta": 0.22107046842575073,
      "pose_rmse_dx": 0.09274602681398392,
      "pose_rmse_dy": 0.07876123487949371,
      "pose_rmse_mean": 0.13085924088954926,
      "rmse_dtheta": 0.02684248425066471,
      "rmse_dx": 0.006005681585520506,
      "rmse_dy": 0.008909428492188454,
      "rmse_mean": 0.013919197022914886,
      "rotation_flip": 0.004524887073785067,
      "sparse_tokens": 32089.0,
      "step": 5823,
      "turn_loss": 0.09465861320495605,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.2705816762683516,
      "grad_norm": 0.625831663608551,
      "learning_rate": 5.313160827678287e-06,
      "loss": 0.1587,
      "mae_dtheta": 0.04239048808813095,
      "mae_dx": 0.01925717294216156,
      "mae_dy": 0.005967279896140099,
      "pose_mae_dtheta": 0.3187035620212555,
      "pose_mae_dx": 0.1359655112028122,
      "pose_mae_dy": 0.09643065929412842,
      "pose_rmse_dtheta": 0.5878013968467712,
      "pose_rmse_dx": 0.27742087841033936,
      "pose_rmse_dy": 0.1913934201002121,
      "pose_rmse_mean": 0.3522052466869354,
      "rmse_dtheta": 0.06185351312160492,
      "rmse_dx": 0.03412687033414841,
      "rmse_dy": 0.009101350791752338,
      "rmse_mean": 0.03502724692225456,
      "rotation_flip": 0.005934718064963818,
      "sparse_tokens": 7477.0,
      "step": 5824,
      "turn_loss": 0.348379522562027,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.2706281360341944,
      "grad_norm": 0.5296204686164856,
      "learning_rate": 5.311841193554723e-06,
      "loss": 0.131,
      "mae_dtheta": 0.043599922209978104,
      "mae_dx": 0.01440174225717783,
      "mae_dy": 0.0062246983870863914,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5296204090118408,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.42996215820312,
      "model/head/act_norm_mean": 111.2559814453125,
      "model/head/act_norm_min": 81.74269104003906,
      "model/head/act_over_embed": 76.45615204412763,
      "model/head/grad_frac": 0.09459693729877472,
      "model/head/grad_norm": 0.05010046809911728,
      "model/head/grad_zero_frac": 0.00020400574430823326,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7004665798611112,
      "model/head/update_ratio": 0.0008563228184357285,
      "model/head/weight_delta": 8.830106735229492,
      "model/head/weight_delta_rel": 0.1549062281847,
      "model/head/weight_norm": 58.50651931762695,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42060160636901855,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42060160636901855,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42060160636901855,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2890413616310684,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09733896702528,
      "model/modality_embedder.encoders.pose/grad_norm": 0.051552701741456985,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.00166644889395684,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8745195865631104,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09391951560974121,
      "model/modality_embedder.encoders.pose/weight_norm": 30.9356632232666,
      "model/modality_embedder/grad_frac": 0.09733896702528,
      "model/modality_embedder/grad_norm": 0.051552701741456985,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.00166644889395684,
      "model/modality_embedder/weight_delta": 2.8745195865631104,
      "model/modality_embedder/weight_delta_rel": 0.09391951560974121,
      "model/modality_embedder/weight_norm": 30.9356632232666,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.52386474609375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.741627741953263,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.35760498046875,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.315468856891165,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07052429765462875,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.037351109087467194,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.00134107971098274,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.237123966217041,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0815221443772316,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.851520538330078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.94113159179688,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.55993544697972,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.791791915893555,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.87781757290278,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06893055886030197,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.036507029086351395,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012337706284597516,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.834991693496704,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09820632636547089,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.58980369567871,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.34228515625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.15622588734568,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.115713119506836,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.974803308228832,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06882162392139435,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.036449335515499115,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011930757900699973,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.0563271045684814,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10262574255466461,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.550729751586914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 75.808837890625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.053800498787478,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.212766647338867,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.278834346585047,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06768711656332016,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.035848479717969894,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012025069445371628,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.6101863384246826,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08920378237962723,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.811452865600586,
      "model/normalizer/grad_frac": 0.2557169198989868,
      "model/normalizer/grad_norm": 0.1354328989982605,
      "model/normalizer/grad_zero_frac": 0.0002576189872343093,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017262287437915802,
      "model/normalizer/weight_delta": 5.529630661010742,
      "model/normalizer/weight_delta_rel": 0.07121843844652176,
      "model/normalizer/weight_norm": 78.45594024658203,
      "pose_mae_dtheta": 0.3591059148311615,
      "pose_mae_dx": 0.12142160534858704,
      "pose_mae_dy": 0.07618135213851929,
      "pose_rmse_dtheta": 0.6035473346710205,
      "pose_rmse_dx": 0.22871223092079163,
      "pose_rmse_dy": 0.16063013672828674,
      "pose_rmse_mean": 0.33096322417259216,
      "rmse_dtheta": 0.06324877589941025,
      "rmse_dx": 0.026747209951281548,
      "rmse_dy": 0.013471369631588459,
      "rmse_mean": 0.03448912128806114,
      "rotation_flip": 0.007272727321833372,
      "sparse_tokens": 9743.0,
      "step": 5825,
      "turn_loss": 0.2791560888290405,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.27067459580003717,
      "grad_norm": 0.5221192836761475,
      "learning_rate": 5.310521537623938e-06,
      "loss": 0.07,
      "mae_dtheta": 0.010619551874697208,
      "mae_dx": 0.0019821072928607464,
      "mae_dy": 0.0022211058530956507,
      "pose_mae_dtheta": 0.06769333779811859,
      "pose_mae_dx": 0.019006598740816116,
      "pose_mae_dy": 0.023265337571501732,
      "pose_rmse_dtheta": 0.18209491670131683,
      "pose_rmse_dx": 0.04807751625776291,
      "pose_rmse_dy": 0.05659735947847366,
      "pose_rmse_mean": 0.09558992832899094,
      "rmse_dtheta": 0.025159303098917007,
      "rmse_dx": 0.0060827103443443775,
      "rmse_dy": 0.00548718823119998,
      "rmse_mean": 0.012243067845702171,
      "rotation_flip": 0.005768438335508108,
      "sparse_tokens": 32105.0,
      "step": 5826,
      "turn_loss": 0.08535094559192657,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.27072105556587994,
      "grad_norm": 0.759557843208313,
      "learning_rate": 5.3092018599782155e-06,
      "loss": 0.1643,
      "mae_dtheta": 0.02742905542254448,
      "mae_dx": 0.011230801232159138,
      "mae_dy": 0.0036178443115204573,
      "pose_mae_dtheta": 0.20639419555664062,
      "pose_mae_dx": 0.08901987969875336,
      "pose_mae_dy": 0.0568210668861866,
      "pose_rmse_dtheta": 0.34706583619117737,
      "pose_rmse_dx": 0.1852424442768097,
      "pose_rmse_dy": 0.14790493249893188,
      "pose_rmse_mean": 0.22673773765563965,
      "rmse_dtheta": 0.04184926673769951,
      "rmse_dx": 0.02320033311843872,
      "rmse_dy": 0.007202113978564739,
      "rmse_mean": 0.024083904922008514,
      "rotation_flip": 0.008379888720810413,
      "sparse_tokens": 6779.0,
      "step": 5827,
      "turn_loss": 0.22593854367733002,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2707675153317227,
      "grad_norm": 0.5372218489646912,
      "learning_rate": 5.307882160709841e-06,
      "loss": 0.106,
      "mae_dtheta": 0.009571492671966553,
      "mae_dx": 0.0017407933482900262,
      "mae_dy": 0.0024456593673676252,
      "pose_mae_dtheta": 0.06412684917449951,
      "pose_mae_dx": 0.020014485344290733,
      "pose_mae_dy": 0.025439683347940445,
      "pose_rmse_dtheta": 0.14006349444389343,
      "pose_rmse_dx": 0.047715649008750916,
      "pose_rmse_dy": 0.053694505244493484,
      "pose_rmse_mean": 0.08049121499061584,
      "rmse_dtheta": 0.020037611946463585,
      "rmse_dx": 0.004855185281485319,
      "rmse_dy": 0.004883738700300455,
      "rmse_mean": 0.009925512596964836,
      "rotation_flip": 0.004078605677932501,
      "sparse_tokens": 32121.0,
      "step": 5828,
      "turn_loss": 0.08150601387023926,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.2708139750975655,
      "grad_norm": 0.5289407968521118,
      "learning_rate": 5.306562439911101e-06,
      "loss": 0.1747,
      "mae_dtheta": 0.031040692701935768,
      "mae_dx": 0.019352396950125694,
      "mae_dy": 0.004514297470450401,
      "pose_mae_dtheta": 0.24812071025371552,
      "pose_mae_dx": 0.14714187383651733,
      "pose_mae_dy": 0.061123043298721313,
      "pose_rmse_dtheta": 0.44536450505256653,
      "pose_rmse_dx": 0.28908202052116394,
      "pose_rmse_dy": 0.14441198110580444,
      "pose_rmse_mean": 0.29295283555984497,
      "rmse_dtheta": 0.04774558171629906,
      "rmse_dx": 0.033094435930252075,
      "rmse_dy": 0.0085248788818717,
      "rmse_mean": 0.029788300395011902,
      "rotation_flip": 0.008113590069115162,
      "sparse_tokens": 9464.0,
      "step": 5829,
      "turn_loss": 0.28402650356292725,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2708604348634083,
      "grad_norm": 0.32060909271240234,
      "learning_rate": 5.3052426976742855e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.00847927387803793,
      "mae_dx": 0.0023935851640999317,
      "mae_dy": 0.0018762536346912384,
      "pose_mae_dtheta": 0.060908641666173935,
      "pose_mae_dx": 0.019939236342906952,
      "pose_mae_dy": 0.018569475039839745,
      "pose_rmse_dtheta": 0.14808793365955353,
      "pose_rmse_dx": 0.057982757687568665,
      "pose_rmse_dy": 0.04362887889146805,
      "pose_rmse_mean": 0.08323319256305695,
      "rmse_dtheta": 0.021341513842344284,
      "rmse_dx": 0.007091202307492495,
      "rmse_dy": 0.005865243263542652,
      "rmse_mean": 0.011432653293013573,
      "rotation_flip": 0.0041649313643574715,
      "sparse_tokens": 32169.0,
      "step": 5830,
      "turn_loss": 0.08181586116552353,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.27090689462925105,
      "grad_norm": 0.40765640139579773,
      "learning_rate": 5.303922934091684e-06,
      "loss": 0.0922,
      "mae_dtheta": 0.009381972253322601,
      "mae_dx": 0.0017892427276819944,
      "mae_dy": 0.0018618053290992975,
      "pose_mae_dtheta": 0.06688106805086136,
      "pose_mae_dx": 0.017663514241576195,
      "pose_mae_dy": 0.019377082586288452,
      "pose_rmse_dtheta": 0.18409286439418793,
      "pose_rmse_dx": 0.04570868983864784,
      "pose_rmse_dy": 0.04622756317257881,
      "pose_rmse_mean": 0.09200970828533173,
      "rmse_dtheta": 0.024226631969213486,
      "rmse_dx": 0.005626576021313667,
      "rmse_dy": 0.005306217819452286,
      "rmse_mean": 0.011719807982444763,
      "rotation_flip": 0.0037296037189662457,
      "sparse_tokens": 32121.0,
      "step": 5831,
      "turn_loss": 0.07603202015161514,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2709533543950938,
      "grad_norm": 0.5527702569961548,
      "learning_rate": 5.302603149255588e-06,
      "loss": 0.171,
      "mae_dtheta": 0.010877285152673721,
      "mae_dx": 0.0035305588971823454,
      "mae_dy": 0.0029146734159439802,
      "pose_mae_dtheta": 0.07403247058391571,
      "pose_mae_dx": 0.04135672375559807,
      "pose_mae_dy": 0.03007112257182598,
      "pose_rmse_dtheta": 0.18107132613658905,
      "pose_rmse_dx": 0.12830623984336853,
      "pose_rmse_dy": 0.07538879662752151,
      "pose_rmse_mean": 0.1282554566860199,
      "rmse_dtheta": 0.023321926593780518,
      "rmse_dx": 0.011656439863145351,
      "rmse_dy": 0.006572403013706207,
      "rmse_mean": 0.01385025680065155,
      "rotation_flip": 0.004385964944958687,
      "sparse_tokens": 32057.0,
      "step": 5832,
      "turn_loss": 0.10854830592870712,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2709998141609366,
      "grad_norm": 0.8563643097877502,
      "learning_rate": 5.301283343258293e-06,
      "loss": 0.1372,
      "mae_dtheta": 0.00977583508938551,
      "mae_dx": 0.002160114236176014,
      "mae_dy": 0.0020955055952072144,
      "pose_mae_dtheta": 0.06891312450170517,
      "pose_mae_dx": 0.02608596906065941,
      "pose_mae_dy": 0.022566895931959152,
      "pose_rmse_dtheta": 0.21870923042297363,
      "pose_rmse_dx": 0.07638993859291077,
      "pose_rmse_dy": 0.06283646821975708,
      "pose_rmse_mean": 0.11931188404560089,
      "rmse_dtheta": 0.02649330347776413,
      "rmse_dx": 0.00675171660259366,
      "rmse_dy": 0.005978024564683437,
      "rmse_mean": 0.01307434868067503,
      "rotation_flip": 0.0028971510473638773,
      "sparse_tokens": 32089.0,
      "step": 5833,
      "turn_loss": 0.07654769718647003,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.27104627392677944,
      "grad_norm": 0.5539708733558655,
      "learning_rate": 5.299963516192091e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.009748918935656548,
      "mae_dx": 0.00170315511059016,
      "mae_dy": 0.0029032828751951456,
      "pose_mae_dtheta": 0.06347215920686722,
      "pose_mae_dx": 0.022365756332874298,
      "pose_mae_dy": 0.026402533054351807,
      "pose_rmse_dtheta": 0.16363348066806793,
      "pose_rmse_dx": 0.055566124618053436,
      "pose_rmse_dy": 0.05458328500390053,
      "pose_rmse_mean": 0.09126096218824387,
      "rmse_dtheta": 0.02015356719493866,
      "rmse_dx": 0.004444017540663481,
      "rmse_dy": 0.005578292533755302,
      "rmse_mean": 0.010058626532554626,
      "rotation_flip": 0.006209251936525106,
      "sparse_tokens": 32121.0,
      "step": 5834,
      "turn_loss": 0.08251659572124481,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2710927336926222,
      "grad_norm": 0.4717105031013489,
      "learning_rate": 5.298643668149279e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.006526678800582886,
      "mae_dx": 0.0013449302641674876,
      "mae_dy": 0.0008744230144657195,
      "pose_mae_dtheta": 0.04782085865736008,
      "pose_mae_dx": 0.01313773449510336,
      "pose_mae_dy": 0.011859970167279243,
      "pose_rmse_dtheta": 0.1727864146232605,
      "pose_rmse_dx": 0.03389767184853554,
      "pose_rmse_dy": 0.03292543813586235,
      "pose_rmse_mean": 0.079869844019413,
      "rmse_dtheta": 0.020944498479366302,
      "rmse_dx": 0.004155091475695372,
      "rmse_dy": 0.002455350011587143,
      "rmse_mean": 0.009184980764985085,
      "rotation_flip": 0.0017657445278018713,
      "sparse_tokens": 32121.0,
      "step": 5835,
      "turn_loss": 0.046734847128391266,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.271139193458465,
      "grad_norm": 0.36796125769615173,
      "learning_rate": 5.297323799222156e-06,
      "loss": 0.0942,
      "mae_dtheta": 0.0071952734142541885,
      "mae_dx": 0.0013583056861534715,
      "mae_dy": 0.0015343551058322191,
      "pose_mae_dtheta": 0.05006132274866104,
      "pose_mae_dx": 0.012784584425389767,
      "pose_mae_dy": 0.015138432383537292,
      "pose_rmse_dtheta": 0.1677667498588562,
      "pose_rmse_dx": 0.03332190215587616,
      "pose_rmse_dy": 0.042041756212711334,
      "pose_rmse_mean": 0.08104347437620163,
      "rmse_dtheta": 0.021288074553012848,
      "rmse_dx": 0.0040656342171132565,
      "rmse_dy": 0.004727733787149191,
      "rmse_mean": 0.010027147829532623,
      "rotation_flip": 0.0023041474632918835,
      "sparse_tokens": 32153.0,
      "step": 5836,
      "turn_loss": 0.06849232316017151,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.27118565322430777,
      "grad_norm": 0.6050541400909424,
      "learning_rate": 5.296003909503019e-06,
      "loss": 0.1238,
      "mae_dtheta": 0.02753998339176178,
      "mae_dx": 0.011883940547704697,
      "mae_dy": 0.0026579133700579405,
      "pose_mae_dtheta": 0.22306817770004272,
      "pose_mae_dx": 0.09675879776477814,
      "pose_mae_dy": 0.03425085172057152,
      "pose_rmse_dtheta": 0.4577135443687439,
      "pose_rmse_dx": 0.24776500463485718,
      "pose_rmse_dy": 0.08734140545129776,
      "pose_rmse_mean": 0.26427334547042847,
      "rmse_dtheta": 0.050601378083229065,
      "rmse_dx": 0.026124555617570877,
      "rmse_dy": 0.0059079877100884914,
      "rmse_mean": 0.027544640004634857,
      "rotation_flip": 0.004761904943734407,
      "sparse_tokens": 8856.0,
      "step": 5837,
      "turn_loss": 0.25512081384658813,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.27123211299015054,
      "grad_norm": 0.45420485734939575,
      "learning_rate": 5.294683999084172e-06,
      "loss": 0.0774,
      "mae_dtheta": 0.011295879259705544,
      "mae_dx": 0.0022061094641685486,
      "mae_dy": 0.002213848987594247,
      "pose_mae_dtheta": 0.07780667394399643,
      "pose_mae_dx": 0.02329426072537899,
      "pose_mae_dy": 0.024937082082033157,
      "pose_rmse_dtheta": 0.20783618092536926,
      "pose_rmse_dx": 0.05281443893909454,
      "pose_rmse_dy": 0.06050552800297737,
      "pose_rmse_mean": 0.10705205798149109,
      "rmse_dtheta": 0.027026137337088585,
      "rmse_dx": 0.00573034817352891,
      "rmse_dy": 0.004987655207514763,
      "rmse_mean": 0.012581381015479565,
      "rotation_flip": 0.004987531341612339,
      "sparse_tokens": 32233.0,
      "step": 5838,
      "turn_loss": 0.08653246611356735,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2712785727559933,
      "grad_norm": 0.6249997019767761,
      "learning_rate": 5.293364068057912e-06,
      "loss": 0.1257,
      "mae_dtheta": 0.009565576910972595,
      "mae_dx": 0.0014890236780047417,
      "mae_dy": 0.002581503242254257,
      "pose_mae_dtheta": 0.06374333798885345,
      "pose_mae_dx": 0.022950895130634308,
      "pose_mae_dy": 0.02971051074564457,
      "pose_rmse_dtheta": 0.13327230513095856,
      "pose_rmse_dx": 0.0661214143037796,
      "pose_rmse_dy": 0.06569510698318481,
      "pose_rmse_mean": 0.08836294710636139,
      "rmse_dtheta": 0.01924058422446251,
      "rmse_dx": 0.004780984483659267,
      "rmse_dy": 0.005678424146026373,
      "rmse_mean": 0.00989999808371067,
      "rotation_flip": 0.004060089122503996,
      "sparse_tokens": 32041.0,
      "step": 5839,
      "turn_loss": 0.07957983016967773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2713250325218361,
      "grad_norm": 0.5834676027297974,
      "learning_rate": 5.292044116516547e-06,
      "loss": 0.1023,
      "mae_dtheta": 0.011165822856128216,
      "mae_dx": 0.001369244186207652,
      "mae_dy": 0.002388086635619402,
      "pose_mae_dtheta": 0.06911803036928177,
      "pose_mae_dx": 0.021480539813637733,
      "pose_mae_dy": 0.030229389667510986,
      "pose_rmse_dtheta": 0.12541936337947845,
      "pose_rmse_dx": 0.05083165317773819,
      "pose_rmse_dy": 0.06459462642669678,
      "pose_rmse_mean": 0.08028188347816467,
      "rmse_dtheta": 0.019953442737460136,
      "rmse_dx": 0.003864490892738104,
      "rmse_dy": 0.004593668505549431,
      "rmse_mean": 0.009470534510910511,
      "rotation_flip": 0.004298941697925329,
      "sparse_tokens": 32105.0,
      "step": 5840,
      "turn_loss": 0.09900179505348206,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.2713714922876789,
      "grad_norm": 0.7197529673576355,
      "learning_rate": 5.290724144552379e-06,
      "loss": 0.1464,
      "mae_dtheta": 0.03461408615112305,
      "mae_dx": 0.009274965152144432,
      "mae_dy": 0.002126280916854739,
      "pose_mae_dtheta": 0.2549489140510559,
      "pose_mae_dx": 0.07643325626850128,
      "pose_mae_dy": 0.028880257159471512,
      "pose_rmse_dtheta": 0.48963025212287903,
      "pose_rmse_dx": 0.1854584515094757,
      "pose_rmse_dy": 0.06886528432369232,
      "pose_rmse_mean": 0.24798467755317688,
      "rmse_dtheta": 0.05371234193444252,
      "rmse_dx": 0.021367058157920837,
      "rmse_dy": 0.004435915965586901,
      "rmse_mean": 0.026505105197429657,
      "rotation_flip": 0.015317286364734173,
      "sparse_tokens": 7564.0,
      "step": 5841,
      "turn_loss": 0.17772378027439117,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 38170.0,
      "epoch": 0.27141795205352165,
      "grad_norm": 0.4783642888069153,
      "learning_rate": 5.289404152257718e-06,
      "loss": 0.1416,
      "mae_dtheta": 0.03924240171909332,
      "mae_dx": 0.012249882332980633,
      "mae_dy": 0.005238644778728485,
      "pose_mae_dtheta": 0.3207542300224304,
      "pose_mae_dx": 0.10108010470867157,
      "pose_mae_dy": 0.0602053739130497,
      "pose_rmse_dtheta": 0.549119234085083,
      "pose_rmse_dx": 0.22397294640541077,
      "pose_rmse_dy": 0.1518775224685669,
      "pose_rmse_mean": 0.3083232343196869,
      "rmse_dtheta": 0.059020575135946274,
      "rmse_dx": 0.023989500477910042,
      "rmse_dy": 0.011648102663457394,
      "rmse_mean": 0.03155272826552391,
      "rotation_flip": 0.015677491202950478,
      "sparse_tokens": 29255.0,
      "step": 5842,
      "turn_loss": 0.321917325258255,
      "turns": 118.0,
      "turns_per_sample": 118.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2714644118193644,
      "grad_norm": 0.45849695801734924,
      "learning_rate": 5.2880841397248675e-06,
      "loss": 0.178,
      "mae_dtheta": 0.010225684382021427,
      "mae_dx": 0.0020949786994606256,
      "mae_dy": 0.0024512503296136856,
      "pose_mae_dtheta": 0.06887727975845337,
      "pose_mae_dx": 0.022348904982209206,
      "pose_mae_dy": 0.02671094425022602,
      "pose_rmse_dtheta": 0.18711329996585846,
      "pose_rmse_dx": 0.05629774183034897,
      "pose_rmse_dy": 0.06213149428367615,
      "pose_rmse_mean": 0.10184751451015472,
      "rmse_dtheta": 0.02372533641755581,
      "rmse_dx": 0.006156813818961382,
      "rmse_dy": 0.006126964930444956,
      "rmse_mean": 0.012003038078546524,
      "rotation_flip": 0.004168245475739241,
      "sparse_tokens": 32121.0,
      "step": 5843,
      "turn_loss": 0.0879746526479721,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.2715108715852072,
      "grad_norm": 0.4913370907306671,
      "learning_rate": 5.286764107046138e-06,
      "loss": 0.0892,
      "mae_dtheta": 0.029660522937774658,
      "mae_dx": 0.01342455018311739,
      "mae_dy": 0.00310853635892272,
      "pose_mae_dtheta": 0.2474532276391983,
      "pose_mae_dx": 0.11352735012769699,
      "pose_mae_dy": 0.04549883306026459,
      "pose_rmse_dtheta": 0.4597432315349579,
      "pose_rmse_dx": 0.2713184952735901,
      "pose_rmse_dy": 0.11712967604398727,
      "pose_rmse_mean": 0.28273046016693115,
      "rmse_dtheta": 0.048200491815805435,
      "rmse_dx": 0.027785424143075943,
      "rmse_dy": 0.006421852391213179,
      "rmse_mean": 0.027469255030155182,
      "rotation_flip": 0.005578800570219755,
      "sparse_tokens": 12660.0,
      "step": 5844,
      "turn_loss": 0.20563361048698425,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.27155733135105,
      "grad_norm": 0.34273362159729004,
      "learning_rate": 5.285444054313841e-06,
      "loss": 0.0824,
      "mae_dtheta": 0.007543548475950956,
      "mae_dx": 0.0015179517213255167,
      "mae_dy": 0.0013595155905932188,
      "pose_mae_dtheta": 0.05492626503109932,
      "pose_mae_dx": 0.015329738147556782,
      "pose_mae_dy": 0.01973854750394821,
      "pose_rmse_dtheta": 0.1393933743238449,
      "pose_rmse_dx": 0.03788258135318756,
      "pose_rmse_dy": 0.049860354512929916,
      "pose_rmse_mean": 0.07571210712194443,
      "rmse_dtheta": 0.019505208358168602,
      "rmse_dx": 0.004664494656026363,
      "rmse_dy": 0.003142494475468993,
      "rmse_mean": 0.009104065597057343,
      "rotation_flip": 0.003405704628676176,
      "sparse_tokens": 32153.0,
      "step": 5845,
      "turn_loss": 0.056971222162246704,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.27160379111689276,
      "grad_norm": 0.4148038923740387,
      "learning_rate": 5.284123981620289e-06,
      "loss": 0.107,
      "mae_dtheta": 0.01134721003472805,
      "mae_dx": 0.0027109524235129356,
      "mae_dy": 0.0014035775093361735,
      "pose_mae_dtheta": 0.08022085577249527,
      "pose_mae_dx": 0.02555830590426922,
      "pose_mae_dy": 0.01825528033077717,
      "pose_rmse_dtheta": 0.2401171624660492,
      "pose_rmse_dx": 0.07748937606811523,
      "pose_rmse_dy": 0.05041239410638809,
      "pose_rmse_mean": 0.12267297506332397,
      "rmse_dtheta": 0.02914230339229107,
      "rmse_dx": 0.008927921764552593,
      "rmse_dy": 0.0035884131211787462,
      "rmse_mean": 0.01388621237128973,
      "rotation_flip": 0.001714285695925355,
      "sparse_tokens": 32105.0,
      "step": 5846,
      "turn_loss": 0.0795779749751091,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.27165025088273553,
      "grad_norm": 0.4968830645084381,
      "learning_rate": 5.282803889057793e-06,
      "loss": 0.0763,
      "mae_dtheta": 0.028626391664147377,
      "mae_dx": 0.018191641196608543,
      "mae_dy": 0.006272806320339441,
      "pose_mae_dtheta": 0.2527715563774109,
      "pose_mae_dx": 0.13554024696350098,
      "pose_mae_dy": 0.09790872037410736,
      "pose_rmse_dtheta": 0.3733510375022888,
      "pose_rmse_dx": 0.2051786184310913,
      "pose_rmse_dy": 0.19587533175945282,
      "pose_rmse_mean": 0.25813502073287964,
      "rmse_dtheta": 0.040204424411058426,
      "rmse_dx": 0.029318824410438538,
      "rmse_dy": 0.009055268950760365,
      "rmse_mean": 0.026192840188741684,
      "rotation_flip": 0.008620689623057842,
      "sparse_tokens": 2189.0,
      "step": 5847,
      "turn_loss": 0.24618768692016602,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.2716967106485783,
      "grad_norm": 0.5321539044380188,
      "learning_rate": 5.281483776718669e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.030997460708022118,
      "mae_dx": 0.013910294510424137,
      "mae_dy": 0.005204113200306892,
      "pose_mae_dtheta": 0.21679909527301788,
      "pose_mae_dx": 0.10610146820545197,
      "pose_mae_dy": 0.07351978123188019,
      "pose_rmse_dtheta": 0.4150799810886383,
      "pose_rmse_dx": 0.2374494969844818,
      "pose_rmse_dy": 0.17108981311321259,
      "pose_rmse_mean": 0.2745397686958313,
      "rmse_dtheta": 0.04913230985403061,
      "rmse_dx": 0.02780168689787388,
      "rmse_dy": 0.00954321026802063,
      "rmse_mean": 0.028825735673308372,
      "rotation_flip": 0.012260536663234234,
      "sparse_tokens": 21478.0,
      "step": 5848,
      "turn_loss": 0.2719513475894928,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2717431704144211,
      "grad_norm": 0.4931497573852539,
      "learning_rate": 5.280163644695234e-06,
      "loss": 0.1208,
      "mae_dtheta": 0.008931366726756096,
      "mae_dx": 0.0018400599947199225,
      "mae_dy": 0.0016514925519004464,
      "pose_mae_dtheta": 0.05929331108927727,
      "pose_mae_dx": 0.022166535258293152,
      "pose_mae_dy": 0.0241477582603693,
      "pose_rmse_dtheta": 0.13428853452205658,
      "pose_rmse_dx": 0.060761403292417526,
      "pose_rmse_dy": 0.052211400121450424,
      "pose_rmse_mean": 0.0824204534292221,
      "rmse_dtheta": 0.020219700410962105,
      "rmse_dx": 0.0059889755211770535,
      "rmse_dy": 0.0035119212698191404,
      "rmse_mean": 0.009906865656375885,
      "rotation_flip": 0.004993190988898277,
      "sparse_tokens": 32073.0,
      "step": 5849,
      "turn_loss": 0.06579291075468063,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.2717896301802639,
      "grad_norm": 0.4389326274394989,
      "learning_rate": 5.278843493079806e-06,
      "loss": 0.1623,
      "mae_dtheta": 0.03874636068940163,
      "mae_dx": 0.012137606739997864,
      "mae_dy": 0.0051660118624567986,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4389326870441437,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 141.21908569335938,
      "model/head/act_norm_mean": 102.0403340657552,
      "model/head/act_norm_min": 71.33731842041016,
      "model/head/act_over_embed": 70.12307288664576,
      "model/head/grad_frac": 0.12593872845172882,
      "model/head/grad_norm": 0.05527862161397934,
      "model/head/grad_zero_frac": 0.00019543941016308963,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.69207763671875,
      "model/head/update_ratio": 0.0009447773336432874,
      "model/head/weight_delta": 8.844271659851074,
      "model/head/weight_delta_rel": 0.15515471994876862,
      "model/head/weight_norm": 58.509681701660156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4206410050392151,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4206410050392151,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4206410050392151,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2890684367660836,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0771624818444252,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03386913612484932,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010948097333312035,
      "model/modality_embedder.encoders.pose/weight_delta": 2.877981185913086,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09403261542320251,
      "model/modality_embedder.encoders.pose/weight_norm": 30.936092376708984,
      "model/modality_embedder/grad_frac": 0.0771624818444252,
      "model/modality_embedder/grad_norm": 0.03386913612484932,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0010948097333312035,
      "model/modality_embedder/weight_delta": 2.877981185913086,
      "model/modality_embedder/weight_delta_rel": 0.09403261542320251,
      "model/modality_embedder/weight_norm": 30.936092376708984,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.61245727539062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.85512256117725,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.138877868652344,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.706254197069624,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08696986734867096,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.038173917680978775,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013705434976145625,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.2427706718444824,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08172791451215744,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.853124618530273,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.0503158569336,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.671895667989418,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.695171356201172,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.26754832282125,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09081064164638519,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03985976055264473,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013469872064888477,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.8420042991638184,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09844925254583359,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.591787338256836,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.6503677368164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.29700675843254,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.181694984436035,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.3843398787035,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0966905802488327,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04244065657258034,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013891025446355343,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.0635251998901367,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10286743938922882,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.55257225036621,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.38227081298828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.200321903935187,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.668428421020508,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.692315865810055,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10069458186626434,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04419814422726631,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014825343387201428,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.6166300773620605,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0894239991903305,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.81256103515625,
      "model/normalizer/grad_frac": 0.36179810762405396,
      "model/normalizer/grad_norm": 0.1588050127029419,
      "model/normalizer/grad_zero_frac": 0.00022334855748340487,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020240768790245056,
      "model/normalizer/weight_delta": 5.543117523193359,
      "model/normalizer/weight_delta_rel": 0.07139214128255844,
      "model/normalizer/weight_norm": 78.45799255371094,
      "pose_mae_dtheta": 0.2888629734516144,
      "pose_mae_dx": 0.10045510530471802,
      "pose_mae_dy": 0.04623114690184593,
      "pose_rmse_dtheta": 0.5236167311668396,
      "pose_rmse_dx": 0.21948479115962982,
      "pose_rmse_dy": 0.11918646097183228,
      "pose_rmse_mean": 0.2874293327331543,
      "rmse_dtheta": 0.059671126306056976,
      "rmse_dx": 0.02400279976427555,
      "rmse_dy": 0.012899717316031456,
      "rmse_mean": 0.03219121694564819,
      "rotation_flip": 0.013910355046391487,
      "sparse_tokens": 12358.0,
      "step": 5850,
      "turn_loss": 0.2996595799922943,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 11705.0,
      "epoch": 0.2718360899461067,
      "grad_norm": 0.5913425087928772,
      "learning_rate": 5.277523321964701e-06,
      "loss": 0.2042,
      "mae_dtheta": 0.03684931993484497,
      "mae_dx": 0.011938396841287613,
      "mae_dy": 0.008415917865931988,
      "pose_mae_dtheta": 0.28110751509666443,
      "pose_mae_dx": 0.10618552565574646,
      "pose_mae_dy": 0.07914847880601883,
      "pose_rmse_dtheta": 0.4768049120903015,
      "pose_rmse_dx": 0.21811443567276,
      "pose_rmse_dy": 0.17093119025230408,
      "pose_rmse_mean": 0.2886168658733368,
      "rmse_dtheta": 0.05478614941239357,
      "rmse_dx": 0.0233320202678442,
      "rmse_dy": 0.01710321381688118,
      "rmse_mean": 0.0317404642701149,
      "rotation_flip": 0.004807692486792803,
      "sparse_tokens": 9713.0,
      "step": 5851,
      "turn_loss": 0.33616316318511963,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.2718825497119495,
      "grad_norm": 0.70004802942276,
      "learning_rate": 5.2762031314422435e-06,
      "loss": 0.2045,
      "mae_dtheta": 0.03217049315571785,
      "mae_dx": 0.011858349665999413,
      "mae_dy": 0.00828105304390192,
      "pose_mae_dtheta": 0.23424115777015686,
      "pose_mae_dx": 0.09697338938713074,
      "pose_mae_dy": 0.07210861146450043,
      "pose_rmse_dtheta": 0.4103145897388458,
      "pose_rmse_dx": 0.23106789588928223,
      "pose_rmse_dy": 0.255214124917984,
      "pose_rmse_mean": 0.29886552691459656,
      "rmse_dtheta": 0.04995111748576164,
      "rmse_dx": 0.0244137030094862,
      "rmse_dy": 0.022967681288719177,
      "rmse_mean": 0.032444167882204056,
      "rotation_flip": 0.01568627543747425,
      "sparse_tokens": 8939.0,
      "step": 5852,
      "turn_loss": 0.3416605293750763,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.27192900947779225,
      "grad_norm": 0.6280251145362854,
      "learning_rate": 5.274882921604751e-06,
      "loss": 0.1509,
      "mae_dtheta": 0.0431344099342823,
      "mae_dx": 0.01136278361082077,
      "mae_dy": 0.0051872218027710915,
      "pose_mae_dtheta": 0.38276880979537964,
      "pose_mae_dx": 0.09294786304235458,
      "pose_mae_dy": 0.08591278642416,
      "pose_rmse_dtheta": 0.6135621666908264,
      "pose_rmse_dx": 0.216777041554451,
      "pose_rmse_dy": 0.212922140955925,
      "pose_rmse_mean": 0.34775376319885254,
      "rmse_dtheta": 0.0645144134759903,
      "rmse_dx": 0.024547914043068886,
      "rmse_dy": 0.010408682748675346,
      "rmse_mean": 0.03315700590610504,
      "rotation_flip": 0.004545454401522875,
      "sparse_tokens": 3350.0,
      "step": 5853,
      "turn_loss": 0.3000212609767914,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.271975469243635,
      "grad_norm": 0.6274281740188599,
      "learning_rate": 5.2735626925445486e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.015319649130105972,
      "mae_dx": 0.0034733081702142954,
      "mae_dy": 0.003698033979162574,
      "pose_mae_dtheta": 0.11316528171300888,
      "pose_mae_dx": 0.039595358073711395,
      "pose_mae_dy": 0.039009999483823776,
      "pose_rmse_dtheta": 0.30435678362846375,
      "pose_rmse_dx": 0.12853367626667023,
      "pose_rmse_dy": 0.10332097858190536,
      "pose_rmse_mean": 0.17873714864253998,
      "rmse_dtheta": 0.03298039734363556,
      "rmse_dx": 0.011182863265275955,
      "rmse_dy": 0.009954897686839104,
      "rmse_mean": 0.018039386719465256,
      "rotation_flip": 0.005757307168096304,
      "sparse_tokens": 32089.0,
      "step": 5854,
      "turn_loss": 0.13246287405490875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2720219290094778,
      "grad_norm": 0.43556779623031616,
      "learning_rate": 5.27224244435396e-06,
      "loss": 0.116,
      "mae_dtheta": 0.008225065656006336,
      "mae_dx": 0.0012931018136441708,
      "mae_dy": 0.0015331231988966465,
      "pose_mae_dtheta": 0.06147634983062744,
      "pose_mae_dx": 0.015335679054260254,
      "pose_mae_dy": 0.022062983363866806,
      "pose_rmse_dtheta": 0.15863078832626343,
      "pose_rmse_dx": 0.04093896225094795,
      "pose_rmse_dy": 0.05647805705666542,
      "pose_rmse_mean": 0.08534927666187286,
      "rmse_dtheta": 0.021045049652457237,
      "rmse_dx": 0.003451974829658866,
      "rmse_dy": 0.003730715485289693,
      "rmse_mean": 0.00940924696624279,
      "rotation_flip": 0.004098360426723957,
      "sparse_tokens": 32153.0,
      "step": 5855,
      "turn_loss": 0.0620325468480587,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2720683887753206,
      "grad_norm": 0.43915289640426636,
      "learning_rate": 5.270922177125312e-06,
      "loss": 0.122,
      "mae_dtheta": 0.008509368635714054,
      "mae_dx": 0.0018727758433669806,
      "mae_dy": 0.0012992359697818756,
      "pose_mae_dtheta": 0.05570598691701889,
      "pose_mae_dx": 0.0179809108376503,
      "pose_mae_dy": 0.013586878776550293,
      "pose_rmse_dtheta": 0.1816723346710205,
      "pose_rmse_dx": 0.039341818541288376,
      "pose_rmse_dy": 0.03566407039761543,
      "pose_rmse_mean": 0.0855594128370285,
      "rmse_dtheta": 0.02465430460870266,
      "rmse_dx": 0.004709852393716574,
      "rmse_dy": 0.0032420349307358265,
      "rmse_mean": 0.010868730954825878,
      "rotation_flip": 0.001402524532750249,
      "sparse_tokens": 32185.0,
      "step": 5856,
      "turn_loss": 0.07178372144699097,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.27211484854116336,
      "grad_norm": 0.6660205721855164,
      "learning_rate": 5.26960189095093e-06,
      "loss": 0.1709,
      "mae_dtheta": 0.05231238529086113,
      "mae_dx": 0.020003775134682655,
      "mae_dy": 0.007911174558103085,
      "pose_mae_dtheta": 0.4875754714012146,
      "pose_mae_dx": 0.17037905752658844,
      "pose_mae_dy": 0.11316070705652237,
      "pose_rmse_dtheta": 0.7725715637207031,
      "pose_rmse_dx": 0.31126680970191956,
      "pose_rmse_dy": 0.24059371650218964,
      "pose_rmse_mean": 0.44147735834121704,
      "rmse_dtheta": 0.07314484566450119,
      "rmse_dx": 0.03411116451025009,
      "rmse_dy": 0.013937928713858128,
      "rmse_mean": 0.04039797931909561,
      "rotation_flip": 0.016949152573943138,
      "sparse_tokens": 10467.0,
      "step": 5857,
      "turn_loss": 0.47502613067626953,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 34606.0,
      "epoch": 0.27216130830700613,
      "grad_norm": 0.7256830930709839,
      "learning_rate": 5.268281585923144e-06,
      "loss": 0.201,
      "mae_dtheta": 0.03725489228963852,
      "mae_dx": 0.01669270545244217,
      "mae_dy": 0.006274255458265543,
      "pose_mae_dtheta": 0.295391321182251,
      "pose_mae_dx": 0.14078140258789062,
      "pose_mae_dy": 0.06817188858985901,
      "pose_rmse_dtheta": 0.4835345447063446,
      "pose_rmse_dx": 0.2830228805541992,
      "pose_rmse_dy": 0.15052691102027893,
      "pose_rmse_mean": 0.3056947886943817,
      "rmse_dtheta": 0.05343518406152725,
      "rmse_dx": 0.030364345759153366,
      "rmse_dy": 0.01122375763952732,
      "rmse_mean": 0.03167442977428436,
      "rotation_flip": 0.021449275314807892,
      "sparse_tokens": 26596.0,
      "step": 5858,
      "turn_loss": 0.3010990023612976,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2722077680728489,
      "grad_norm": 0.4314078390598297,
      "learning_rate": 5.266961262134281e-06,
      "loss": 0.1143,
      "mae_dtheta": 0.009710934944450855,
      "mae_dx": 0.0024455648381263018,
      "mae_dy": 0.0027985703200101852,
      "pose_mae_dtheta": 0.06863698363304138,
      "pose_mae_dx": 0.031192142516374588,
      "pose_mae_dy": 0.03408355638384819,
      "pose_rmse_dtheta": 0.17923800647258759,
      "pose_rmse_dx": 0.08926766365766525,
      "pose_rmse_dy": 0.07847269624471664,
      "pose_rmse_mean": 0.11565946042537689,
      "rmse_dtheta": 0.020765651017427444,
      "rmse_dx": 0.008495460264384747,
      "rmse_dy": 0.005999147426337004,
      "rmse_mean": 0.01175342034548521,
      "rotation_flip": 0.0033970274962484837,
      "sparse_tokens": 32089.0,
      "step": 5859,
      "turn_loss": 0.095931775867939,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2722542278386917,
      "grad_norm": 0.42721378803253174,
      "learning_rate": 5.265640919676676e-06,
      "loss": 0.078,
      "mae_dtheta": 0.010111367329955101,
      "mae_dx": 0.0013202850241214037,
      "mae_dy": 0.0017136052483692765,
      "pose_mae_dtheta": 0.06564348191022873,
      "pose_mae_dx": 0.0181900467723608,
      "pose_mae_dy": 0.023230761289596558,
      "pose_rmse_dtheta": 0.19507303833961487,
      "pose_rmse_dx": 0.04593491926789284,
      "pose_rmse_dy": 0.058124981820583344,
      "pose_rmse_mean": 0.09971098601818085,
      "rmse_dtheta": 0.02478213794529438,
      "rmse_dx": 0.0038940056692808867,
      "rmse_dy": 0.0040374258533120155,
      "rmse_mean": 0.0109045235440135,
      "rotation_flip": 0.003294892841950059,
      "sparse_tokens": 32105.0,
      "step": 5860,
      "turn_loss": 0.06635181605815887,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.27230068760453446,
      "grad_norm": 0.6020394563674927,
      "learning_rate": 5.264320558642657e-06,
      "loss": 0.2048,
      "mae_dtheta": 0.041362062096595764,
      "mae_dx": 0.014333046972751617,
      "mae_dy": 0.0054744514636695385,
      "pose_mae_dtheta": 0.32592737674713135,
      "pose_mae_dx": 0.10786920040845871,
      "pose_mae_dy": 0.06988020241260529,
      "pose_rmse_dtheta": 0.5917861461639404,
      "pose_rmse_dx": 0.24427036941051483,
      "pose_rmse_dy": 0.15896977484226227,
      "pose_rmse_mean": 0.3316754400730133,
      "rmse_dtheta": 0.06027530878782272,
      "rmse_dx": 0.027577335014939308,
      "rmse_dy": 0.009770284406840801,
      "rmse_mean": 0.032540977001190186,
      "rotation_flip": 0.020537124946713448,
      "sparse_tokens": 20395.0,
      "step": 5861,
      "turn_loss": 0.29277974367141724,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.27234714737037724,
      "grad_norm": 0.4778439700603485,
      "learning_rate": 5.2630001791245614e-06,
      "loss": 0.1549,
      "mae_dtheta": 0.018991122022271156,
      "mae_dx": 0.009229582734405994,
      "mae_dy": 0.0037816388066858053,
      "pose_mae_dtheta": 0.12475939095020294,
      "pose_mae_dx": 0.07707914710044861,
      "pose_mae_dy": 0.05263363942503929,
      "pose_rmse_dtheta": 0.22814619541168213,
      "pose_rmse_dx": 0.23868975043296814,
      "pose_rmse_dy": 0.10979817062616348,
      "pose_rmse_mean": 0.19221137464046478,
      "rmse_dtheta": 0.03223409503698349,
      "rmse_dx": 0.022967206314206123,
      "rmse_dy": 0.007640583906322718,
      "rmse_mean": 0.020947296172380447,
      "rotation_flip": 0.008230452425777912,
      "sparse_tokens": 5496.0,
      "step": 5862,
      "turn_loss": 0.18027694523334503,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.27239360713622,
      "grad_norm": 0.43106013536453247,
      "learning_rate": 5.2616797812147205e-06,
      "loss": 0.1139,
      "mae_dtheta": 0.014581708237528801,
      "mae_dx": 0.0031414830591529608,
      "mae_dy": 0.004529385827481747,
      "pose_mae_dtheta": 0.10315031558275223,
      "pose_mae_dx": 0.0386032797396183,
      "pose_mae_dy": 0.039699070155620575,
      "pose_rmse_dtheta": 0.2050117552280426,
      "pose_rmse_dx": 0.10306408256292343,
      "pose_rmse_dy": 0.07692813873291016,
      "pose_rmse_mean": 0.1283346712589264,
      "rmse_dtheta": 0.02704077959060669,
      "rmse_dx": 0.009533697739243507,
      "rmse_dy": 0.009259629063308239,
      "rmse_mean": 0.015278035774827003,
      "rotation_flip": 0.005053908564150333,
      "sparse_tokens": 32057.0,
      "step": 5863,
      "turn_loss": 0.1432729810476303,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.2724400669020628,
      "grad_norm": 0.4463631510734558,
      "learning_rate": 5.260359365005472e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.008019071072340012,
      "mae_dx": 0.0020479236263781786,
      "mae_dy": 0.0026980580296367407,
      "pose_mae_dtheta": 0.05928559601306915,
      "pose_mae_dx": 0.02546399086713791,
      "pose_mae_dy": 0.02684376947581768,
      "pose_rmse_dtheta": 0.1442461460828781,
      "pose_rmse_dx": 0.07445228099822998,
      "pose_rmse_dy": 0.07127223163843155,
      "pose_rmse_mean": 0.09665688872337341,
      "rmse_dtheta": 0.019241373986005783,
      "rmse_dx": 0.006744079291820526,
      "rmse_dy": 0.006957726087421179,
      "rmse_mean": 0.0109810596331954,
      "rotation_flip": 0.008667388930916786,
      "sparse_tokens": 32025.0,
      "step": 5864,
      "turn_loss": 0.08404527604579926,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.27248652666790557,
      "grad_norm": 0.6433284282684326,
      "learning_rate": 5.259038930589154e-06,
      "loss": 0.1851,
      "mae_dtheta": 0.03278932720422745,
      "mae_dx": 0.010610587894916534,
      "mae_dy": 0.005655611865222454,
      "pose_mae_dtheta": 0.2401605099439621,
      "pose_mae_dx": 0.09310127049684525,
      "pose_mae_dy": 0.06016702950000763,
      "pose_rmse_dtheta": 0.4565744400024414,
      "pose_rmse_dx": 0.21817880868911743,
      "pose_rmse_dy": 0.1307654231786728,
      "pose_rmse_mean": 0.2685062289237976,
      "rmse_dtheta": 0.051491569727659225,
      "rmse_dx": 0.0224569421261549,
      "rmse_dy": 0.011122658848762512,
      "rmse_mean": 0.02835705690085888,
      "rotation_flip": 0.013686912134289742,
      "sparse_tokens": 19624.0,
      "step": 5865,
      "turn_loss": 0.2647424638271332,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 24264.0,
      "epoch": 0.27253298643374835,
      "grad_norm": 0.4669508934020996,
      "learning_rate": 5.257718478058105e-06,
      "loss": 0.1449,
      "mae_dtheta": 0.03669002652168274,
      "mae_dx": 0.010711004957556725,
      "mae_dy": 0.004014554899185896,
      "pose_mae_dtheta": 0.2980976700782776,
      "pose_mae_dx": 0.08782590925693512,
      "pose_mae_dy": 0.046840790659189224,
      "pose_rmse_dtheta": 0.5263330936431885,
      "pose_rmse_dx": 0.20559263229370117,
      "pose_rmse_dy": 0.1180766224861145,
      "pose_rmse_mean": 0.2833341360092163,
      "rmse_dtheta": 0.05548854544758797,
      "rmse_dx": 0.02308840863406658,
      "rmse_dy": 0.008703511208295822,
      "rmse_mean": 0.029093489050865173,
      "rotation_flip": 0.011545293033123016,
      "sparse_tokens": 18485.0,
      "step": 5866,
      "turn_loss": 0.24512521922588348,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.2725794461995912,
      "grad_norm": 0.41035929322242737,
      "learning_rate": 5.2563980075046625e-06,
      "loss": 0.0889,
      "mae_dtheta": 0.022788336500525475,
      "mae_dx": 0.0072309221141040325,
      "mae_dy": 0.0033669867552816868,
      "pose_mae_dtheta": 0.16949160397052765,
      "pose_mae_dx": 0.06620073318481445,
      "pose_mae_dy": 0.0486985482275486,
      "pose_rmse_dtheta": 0.28453925251960754,
      "pose_rmse_dx": 0.176484152674675,
      "pose_rmse_dy": 0.1271231472492218,
      "pose_rmse_mean": 0.19604885578155518,
      "rmse_dtheta": 0.03578389808535576,
      "rmse_dx": 0.01793181151151657,
      "rmse_dy": 0.007044588215649128,
      "rmse_mean": 0.020253432914614677,
      "rotation_flip": 0.011682243086397648,
      "sparse_tokens": 7401.0,
      "step": 5867,
      "turn_loss": 0.16529761254787445,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.27262590596543396,
      "grad_norm": 0.4335799813270569,
      "learning_rate": 5.255077519021171e-06,
      "loss": 0.0951,
      "mae_dtheta": 0.0418056957423687,
      "mae_dx": 0.014396325685083866,
      "mae_dy": 0.009907274506986141,
      "pose_mae_dtheta": 0.3558969795703888,
      "pose_mae_dx": 0.11037608981132507,
      "pose_mae_dy": 0.10203183442354202,
      "pose_rmse_dtheta": 0.587960422039032,
      "pose_rmse_dx": 0.23326872289180756,
      "pose_rmse_dy": 0.22197572886943817,
      "pose_rmse_mean": 0.3477349877357483,
      "rmse_dtheta": 0.06035934016108513,
      "rmse_dx": 0.02717633545398712,
      "rmse_dy": 0.020553212612867355,
      "rmse_mean": 0.0360296331346035,
      "rotation_flip": 0.016815034672617912,
      "sparse_tokens": 17641.0,
      "step": 5868,
      "turn_loss": 0.3402969539165497,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 36226.0,
      "epoch": 0.27267236573127673,
      "grad_norm": 0.9147267937660217,
      "learning_rate": 5.253757012699972e-06,
      "loss": 0.2483,
      "mae_dtheta": 0.03460991010069847,
      "mae_dx": 0.012292432598769665,
      "mae_dy": 0.005343603901565075,
      "pose_mae_dtheta": 0.24969127774238586,
      "pose_mae_dx": 0.09661362320184708,
      "pose_mae_dy": 0.07069195806980133,
      "pose_rmse_dtheta": 0.4379776418209076,
      "pose_rmse_dx": 0.2279921919107437,
      "pose_rmse_dy": 0.1555701047182083,
      "pose_rmse_mean": 0.27384665608406067,
      "rmse_dtheta": 0.051865119487047195,
      "rmse_dx": 0.026052873581647873,
      "rmse_dy": 0.010082412511110306,
      "rmse_mean": 0.02933346852660179,
      "rotation_flip": 0.014434180222451687,
      "sparse_tokens": 27960.0,
      "step": 5869,
      "turn_loss": 0.2528247833251953,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 38613.0,
      "epoch": 0.2727188254971195,
      "grad_norm": 0.6440933346748352,
      "learning_rate": 5.252436488633408e-06,
      "loss": 0.169,
      "mae_dtheta": 0.028716249391436577,
      "mae_dx": 0.01276310719549656,
      "mae_dy": 0.0032566424924880266,
      "pose_mae_dtheta": 0.22602280974388123,
      "pose_mae_dx": 0.09450459480285645,
      "pose_mae_dy": 0.0355263352394104,
      "pose_rmse_dtheta": 0.4060342609882355,
      "pose_rmse_dx": 0.2125825583934784,
      "pose_rmse_dy": 0.0936732292175293,
      "pose_rmse_mean": 0.23743002116680145,
      "rmse_dtheta": 0.04646250605583191,
      "rmse_dx": 0.02482604794204235,
      "rmse_dy": 0.00777597026899457,
      "rmse_mean": 0.026354841887950897,
      "rotation_flip": 0.008343265391886234,
      "sparse_tokens": 26823.0,
      "step": 5870,
      "turn_loss": 0.21976234018802643,
      "turns": 119.0,
      "turns_per_sample": 119.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2727652852629623,
      "grad_norm": 0.4368663430213928,
      "learning_rate": 5.251115946913826e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.0132674565538764,
      "mae_dx": 0.003043544013053179,
      "mae_dy": 0.003629612270742655,
      "pose_mae_dtheta": 0.10008259117603302,
      "pose_mae_dx": 0.03360239788889885,
      "pose_mae_dy": 0.03271745517849922,
      "pose_rmse_dtheta": 0.25162550806999207,
      "pose_rmse_dx": 0.09573080390691757,
      "pose_rmse_dy": 0.08249920606613159,
      "pose_rmse_mean": 0.14328518509864807,
      "rmse_dtheta": 0.03012545220553875,
      "rmse_dx": 0.00838129036128521,
      "rmse_dy": 0.008538912981748581,
      "rmse_mean": 0.015681885182857513,
      "rotation_flip": 0.0066225165501236916,
      "sparse_tokens": 32089.0,
      "step": 5871,
      "turn_loss": 0.11238010227680206,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.27281174502880506,
      "grad_norm": 0.5333488583564758,
      "learning_rate": 5.249795387633571e-06,
      "loss": 0.1352,
      "mae_dtheta": 0.013443633913993835,
      "mae_dx": 0.002506630728021264,
      "mae_dy": 0.0033499794080853462,
      "pose_mae_dtheta": 0.0914669930934906,
      "pose_mae_dx": 0.0341913104057312,
      "pose_mae_dy": 0.040501661598682404,
      "pose_rmse_dtheta": 0.18637563288211823,
      "pose_rmse_dx": 0.09681558609008789,
      "pose_rmse_dy": 0.0820019468665123,
      "pose_rmse_mean": 0.12173105776309967,
      "rmse_dtheta": 0.024770043790340424,
      "rmse_dx": 0.00818928424268961,
      "rmse_dy": 0.0063219936564564705,
      "rmse_mean": 0.013093773275613785,
      "rotation_flip": 0.004588775336742401,
      "sparse_tokens": 32057.0,
      "step": 5872,
      "turn_loss": 0.10871130228042603,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.27285820479464784,
      "grad_norm": 0.5448417663574219,
      "learning_rate": 5.248474810884988e-06,
      "loss": 0.1189,
      "mae_dtheta": 0.006931882351636887,
      "mae_dx": 0.0014624070608988404,
      "mae_dy": 0.0012732314644381404,
      "pose_mae_dtheta": 0.046982549130916595,
      "pose_mae_dx": 0.013677037321031094,
      "pose_mae_dy": 0.016260238364338875,
      "pose_rmse_dtheta": 0.13542120158672333,
      "pose_rmse_dx": 0.03566499054431915,
      "pose_rmse_dy": 0.04209575057029724,
      "pose_rmse_mean": 0.0710606500506401,
      "rmse_dtheta": 0.019439414143562317,
      "rmse_dx": 0.004712550900876522,
      "rmse_dy": 0.003908890299499035,
      "rmse_mean": 0.009353619068861008,
      "rotation_flip": 0.0032095368951559067,
      "sparse_tokens": 32121.0,
      "step": 5873,
      "turn_loss": 0.06102386489510536,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2729046645604906,
      "grad_norm": 0.47409170866012573,
      "learning_rate": 5.247154216760431e-06,
      "loss": 0.1232,
      "mae_dtheta": 0.008938889019191265,
      "mae_dx": 0.0014566861791536212,
      "mae_dy": 0.0017673301044851542,
      "pose_mae_dtheta": 0.05945863574743271,
      "pose_mae_dx": 0.018581489101052284,
      "pose_mae_dy": 0.020765885710716248,
      "pose_rmse_dtheta": 0.13773587346076965,
      "pose_rmse_dx": 0.046145129948854446,
      "pose_rmse_dy": 0.05370142310857773,
      "pose_rmse_mean": 0.07919414341449738,
      "rmse_dtheta": 0.02101399376988411,
      "rmse_dx": 0.004096555523574352,
      "rmse_dy": 0.004138697870075703,
      "rmse_mean": 0.009749749675393105,
      "rotation_flip": 0.003106968477368355,
      "sparse_tokens": 32105.0,
      "step": 5874,
      "turn_loss": 0.07465427368879318,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2729511243263334,
      "grad_norm": 0.5505136847496033,
      "learning_rate": 5.245833605352246e-06,
      "loss": 0.0871,
      "mae_dtheta": 0.012422353960573673,
      "mae_dx": 0.0027146516367793083,
      "mae_dy": 0.0029278278816491365,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5505136251449585,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.31895446777344,
      "model/head/act_norm_mean": 108.86218631628788,
      "model/head/act_norm_min": 58.21390151977539,
      "model/head/act_over_embed": 74.81111362039883,
      "model/head/grad_frac": 0.09791620820760727,
      "model/head/grad_norm": 0.053904205560684204,
      "model/head/grad_zero_frac": 0.00017703764024190605,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7051027856691919,
      "model/head/update_ratio": 0.0009212408331222832,
      "model/head/weight_delta": 8.856648445129395,
      "model/head/weight_delta_rel": 0.15537184476852417,
      "model/head/weight_norm": 58.512611389160156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4206579327583313,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4206035735944635,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.420541375875473,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2890427135268116,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08990741521120071,
      "model/modality_embedder.encoders.pose/grad_norm": 0.049495257437229156,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.529359303652968,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015998836606740952,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8846445083618164,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09425032883882523,
      "model/modality_embedder.encoders.pose/weight_norm": 30.936784744262695,
      "model/modality_embedder/grad_frac": 0.08990741521120071,
      "model/modality_embedder/grad_norm": 0.049495257437229156,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.529359303652968,
      "model/modality_embedder/update_ratio": 0.0015998836606740952,
      "model/modality_embedder/weight_delta": 2.8846445083618164,
      "model/modality_embedder/weight_delta_rel": 0.09425032883882523,
      "model/modality_embedder/weight_norm": 30.936784744262695,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.72041320800781,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.489290223665222,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.010293006896973,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.142060151902555,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06569020450115204,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03616335242986679,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012982971966266632,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.2486579418182373,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08194245398044586,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.854448318481445,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.2791519165039,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.45854627625461,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.34543514251709,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.808141985560116,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07305964082479477,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04022032767534256,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013590729795396328,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.849667549133301,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09871470928192139,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.593942642211914,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.49591064453125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.349206349206348,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.469063758850098,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.107421288331032,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08005698025226593,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.044072456657886505,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014423989923670888,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.0717666149139404,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10314416885375977,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.554967880249023,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.77669525146484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.155077561327563,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.649670600891113,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.34843289213339,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09289602190256119,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.051140524446964264,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017152762738987803,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.6236119270324707,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08966260403394699,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.81474494934082,
      "model/normalizer/grad_frac": 0.3289496898651123,
      "model/normalizer/grad_norm": 0.1810912936925888,
      "model/normalizer/grad_zero_frac": 0.00016307989426422864,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0023080536630004644,
      "model/normalizer/weight_delta": 5.55786657333374,
      "model/normalizer/weight_delta_rel": 0.07158210128545761,
      "model/normalizer/weight_norm": 78.46060943603516,
      "pose_mae_dtheta": 0.08793514221906662,
      "pose_mae_dx": 0.03542713820934296,
      "pose_mae_dy": 0.03633720800280571,
      "pose_rmse_dtheta": 0.21681176126003265,
      "pose_rmse_dx": 0.10659975558519363,
      "pose_rmse_dy": 0.0836641862988472,
      "pose_rmse_mean": 0.13569191098213196,
      "rmse_dtheta": 0.024700745940208435,
      "rmse_dx": 0.00929489266127348,
      "rmse_dy": 0.006675399374216795,
      "rmse_mean": 0.013557013124227524,
      "rotation_flip": 0.005959475412964821,
      "sparse_tokens": 32073.0,
      "step": 5875,
      "turn_loss": 0.09165044128894806,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2302.0,
      "epoch": 0.27299758409217617,
      "grad_norm": 0.5543521642684937,
      "learning_rate": 5.2445129767527844e-06,
      "loss": 0.081,
      "mae_dtheta": 0.03334834799170494,
      "mae_dx": 0.0347517728805542,
      "mae_dy": 0.010336672887206078,
      "pose_mae_dtheta": 0.29551053047180176,
      "pose_mae_dx": 0.316440224647522,
      "pose_mae_dy": 0.19786784052848816,
      "pose_rmse_dtheta": 0.37979429960250854,
      "pose_rmse_dx": 0.4906962811946869,
      "pose_rmse_dy": 0.2996741831302643,
      "pose_rmse_mean": 0.3900549113750458,
      "rmse_dtheta": 0.040626149624586105,
      "rmse_dx": 0.04827644303441048,
      "rmse_dy": 0.013389229774475098,
      "rmse_mean": 0.034097276628017426,
      "rotation_flip": 0.016129031777381897,
      "sparse_tokens": 1959.0,
      "step": 5876,
      "turn_loss": 0.3896211087703705,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.27304404385801895,
      "grad_norm": 0.5535165071487427,
      "learning_rate": 5.243192331054401e-06,
      "loss": 0.075,
      "mae_dtheta": 0.028178604319691658,
      "mae_dx": 0.011666489765048027,
      "mae_dy": 0.0037649290170520544,
      "pose_mae_dtheta": 0.20538052916526794,
      "pose_mae_dx": 0.09354531019926071,
      "pose_mae_dy": 0.03368254378437996,
      "pose_rmse_dtheta": 0.38600632548332214,
      "pose_rmse_dx": 0.19543106853961945,
      "pose_rmse_dy": 0.08170681446790695,
      "pose_rmse_mean": 0.22104808688163757,
      "rmse_dtheta": 0.04547248035669327,
      "rmse_dx": 0.022868966683745384,
      "rmse_dy": 0.00759093975648284,
      "rmse_mean": 0.02531079761683941,
      "rotation_flip": 0.008992806077003479,
      "sparse_tokens": 8750.0,
      "step": 5877,
      "turn_loss": 0.2640455961227417,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.2730905036238617,
      "grad_norm": 0.6831185221672058,
      "learning_rate": 5.241871668349445e-06,
      "loss": 0.1709,
      "mae_dtheta": 0.03710627183318138,
      "mae_dx": 0.012314674444496632,
      "mae_dy": 0.005278960335999727,
      "pose_mae_dtheta": 0.30090537667274475,
      "pose_mae_dx": 0.10572948306798935,
      "pose_mae_dy": 0.06546788662672043,
      "pose_rmse_dtheta": 0.5314464569091797,
      "pose_rmse_dx": 0.2286376804113388,
      "pose_rmse_dy": 0.15460847318172455,
      "pose_rmse_mean": 0.3048975467681885,
      "rmse_dtheta": 0.05632757768034935,
      "rmse_dx": 0.02470635436475277,
      "rmse_dy": 0.010007067583501339,
      "rmse_mean": 0.030347000807523727,
      "rotation_flip": 0.003409090917557478,
      "sparse_tokens": 18523.0,
      "step": 5878,
      "turn_loss": 0.2486296445131302,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.2731369633897045,
      "grad_norm": 0.6136548519134521,
      "learning_rate": 5.240550988730275e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.033591128885746,
      "mae_dx": 0.01639040932059288,
      "mae_dy": 0.008887807838618755,
      "pose_mae_dtheta": 0.27507534623146057,
      "pose_mae_dx": 0.14122024178504944,
      "pose_mae_dy": 0.15361455082893372,
      "pose_rmse_dtheta": 0.4000947177410126,
      "pose_rmse_dx": 0.26410940289497375,
      "pose_rmse_dy": 0.2668675184249878,
      "pose_rmse_mean": 0.3103572130203247,
      "rmse_dtheta": 0.04644082114100456,
      "rmse_dx": 0.03113578073680401,
      "rmse_dy": 0.012644529342651367,
      "rmse_mean": 0.030073709785938263,
      "rotation_flip": 0.009259259328246117,
      "sparse_tokens": 3886.0,
      "step": 5879,
      "turn_loss": 0.3089507818222046,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.2731834231555473,
      "grad_norm": 0.6829418540000916,
      "learning_rate": 5.239230292289246e-06,
      "loss": 0.1513,
      "mae_dtheta": 0.028773782774806023,
      "mae_dx": 0.009291661903262138,
      "mae_dy": 0.004279152024537325,
      "pose_mae_dtheta": 0.23382127285003662,
      "pose_mae_dx": 0.06720346957445145,
      "pose_mae_dy": 0.05590401962399483,
      "pose_rmse_dtheta": 0.3680494427680969,
      "pose_rmse_dx": 0.15598341822624207,
      "pose_rmse_dy": 0.15134233236312866,
      "pose_rmse_mean": 0.22512505948543549,
      "rmse_dtheta": 0.04180895537137985,
      "rmse_dx": 0.02025706134736538,
      "rmse_dy": 0.008702840656042099,
      "rmse_mean": 0.023589622229337692,
      "rotation_flip": 0.008237232454121113,
      "sparse_tokens": 9911.0,
      "step": 5880,
      "turn_loss": 0.23212683200836182,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.27322988292139005,
      "grad_norm": 0.5129460692405701,
      "learning_rate": 5.237909579118713e-06,
      "loss": 0.0966,
      "mae_dtheta": 0.010804270394146442,
      "mae_dx": 0.004207083024084568,
      "mae_dy": 0.0006365514709614217,
      "pose_mae_dtheta": 0.06919240951538086,
      "pose_mae_dx": 0.039752859622240067,
      "pose_mae_dy": 0.007527681067585945,
      "pose_rmse_dtheta": 0.2563692629337311,
      "pose_rmse_dx": 0.11739110946655273,
      "pose_rmse_dy": 0.0244482159614563,
      "pose_rmse_mean": 0.1327362060546875,
      "rmse_dtheta": 0.03450579568743706,
      "rmse_dx": 0.012496216222643852,
      "rmse_dy": 0.0016987768467515707,
      "rmse_mean": 0.016233596950769424,
      "rotation_flip": 0.001936733373440802,
      "sparse_tokens": 32185.0,
      "step": 5881,
      "turn_loss": 0.12548960745334625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.27327634268723283,
      "grad_norm": 0.5355918407440186,
      "learning_rate": 5.236588849311035e-06,
      "loss": 0.0867,
      "mae_dtheta": 0.009252825751900673,
      "mae_dx": 0.0011942259734496474,
      "mae_dy": 0.0017284193309023976,
      "pose_mae_dtheta": 0.05964595824480057,
      "pose_mae_dx": 0.016837872564792633,
      "pose_mae_dy": 0.023402059450745583,
      "pose_rmse_dtheta": 0.17577359080314636,
      "pose_rmse_dx": 0.046746060252189636,
      "pose_rmse_dy": 0.06260257959365845,
      "pose_rmse_mean": 0.09504073858261108,
      "rmse_dtheta": 0.022744998335838318,
      "rmse_dx": 0.003610058454796672,
      "rmse_dy": 0.003925613593310118,
      "rmse_mean": 0.010093556717038155,
      "rotation_flip": 0.00520381610840559,
      "sparse_tokens": 32073.0,
      "step": 5882,
      "turn_loss": 0.06653069704771042,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.27332280245307566,
      "grad_norm": 0.5377374887466431,
      "learning_rate": 5.235268102958573e-06,
      "loss": 0.1132,
      "mae_dtheta": 0.03911330923438072,
      "mae_dx": 0.014140843413770199,
      "mae_dy": 0.005266567226499319,
      "pose_mae_dtheta": 0.32188987731933594,
      "pose_mae_dx": 0.11800853163003922,
      "pose_mae_dy": 0.06502225250005722,
      "pose_rmse_dtheta": 0.502016544342041,
      "pose_rmse_dx": 0.2546898126602173,
      "pose_rmse_dy": 0.15022175014019012,
      "pose_rmse_mean": 0.30230939388275146,
      "rmse_dtheta": 0.05476522818207741,
      "rmse_dx": 0.027490127831697464,
      "rmse_dy": 0.009314030408859253,
      "rmse_mean": 0.030523128807544708,
      "rotation_flip": 0.015410958789288998,
      "sparse_tokens": 19984.0,
      "step": 5883,
      "turn_loss": 0.3631138801574707,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.27336926221891844,
      "grad_norm": 0.5538829565048218,
      "learning_rate": 5.233947340153686e-06,
      "loss": 0.18,
      "mae_dtheta": 0.008949585258960724,
      "mae_dx": 0.0009941257303580642,
      "mae_dy": 0.0020168691407889128,
      "pose_mae_dtheta": 0.0631844773888588,
      "pose_mae_dx": 0.015520766377449036,
      "pose_mae_dy": 0.02707570791244507,
      "pose_rmse_dtheta": 0.17441464960575104,
      "pose_rmse_dx": 0.046668317168951035,
      "pose_rmse_dy": 0.06177383288741112,
      "pose_rmse_mean": 0.09428559988737106,
      "rmse_dtheta": 0.022348621860146523,
      "rmse_dx": 0.003929674159735441,
      "rmse_dy": 0.004532447550445795,
      "rmse_mean": 0.010270248167216778,
      "rotation_flip": 0.004772004205733538,
      "sparse_tokens": 32025.0,
      "step": 5884,
      "turn_loss": 0.07308820635080338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2734157219847612,
      "grad_norm": 0.5715578198432922,
      "learning_rate": 5.232626560988735e-06,
      "loss": 0.07,
      "mae_dtheta": 0.008391361683607101,
      "mae_dx": 0.0020275828428566456,
      "mae_dy": 0.0018905894830822945,
      "pose_mae_dtheta": 0.05367349833250046,
      "pose_mae_dx": 0.017949054017663002,
      "pose_mae_dy": 0.01738014444708824,
      "pose_rmse_dtheta": 0.14297574758529663,
      "pose_rmse_dx": 0.04752473160624504,
      "pose_rmse_dy": 0.041395802050828934,
      "pose_rmse_mean": 0.07729876041412354,
      "rmse_dtheta": 0.020042145624756813,
      "rmse_dx": 0.006414869800209999,
      "rmse_dy": 0.005111489444971085,
      "rmse_mean": 0.010522834956645966,
      "rotation_flip": 0.002683020429685712,
      "sparse_tokens": 32137.0,
      "step": 5885,
      "turn_loss": 0.06914211809635162,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.273462181750604,
      "grad_norm": 0.5817428231239319,
      "learning_rate": 5.231305765556083e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.02462570182979107,
      "mae_dx": 0.011857538484036922,
      "mae_dy": 0.005458584520965815,
      "pose_mae_dtheta": 0.17776824533939362,
      "pose_mae_dx": 0.09214901924133301,
      "pose_mae_dy": 0.06992358714342117,
      "pose_rmse_dtheta": 0.3141521215438843,
      "pose_rmse_dx": 0.22234711050987244,
      "pose_rmse_dy": 0.155207559466362,
      "pose_rmse_mean": 0.23056894540786743,
      "rmse_dtheta": 0.039262715727090836,
      "rmse_dx": 0.025771332904696465,
      "rmse_dy": 0.01057309191673994,
      "rmse_mean": 0.025202378630638123,
      "rotation_flip": 0.011636927723884583,
      "sparse_tokens": 22121.0,
      "step": 5886,
      "turn_loss": 0.26523277163505554,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.27350864151644677,
      "grad_norm": 0.5185120701789856,
      "learning_rate": 5.2299849539480965e-06,
      "loss": 0.1262,
      "mae_dtheta": 0.02903319150209427,
      "mae_dx": 0.010388510301709175,
      "mae_dy": 0.006026294082403183,
      "pose_mae_dtheta": 0.17646172642707825,
      "pose_mae_dx": 0.0674724280834198,
      "pose_mae_dy": 0.08580083400011063,
      "pose_rmse_dtheta": 0.27492672204971313,
      "pose_rmse_dx": 0.14689256250858307,
      "pose_rmse_dy": 0.17484961450099945,
      "pose_rmse_mean": 0.19888964295387268,
      "rmse_dtheta": 0.04139260947704315,
      "rmse_dx": 0.0222540982067585,
      "rmse_dy": 0.010141163133084774,
      "rmse_mean": 0.024595957249403,
      "rotation_flip": 0.020512821152806282,
      "sparse_tokens": 6792.0,
      "step": 5887,
      "turn_loss": 0.26967960596084595,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.27355510128228955,
      "grad_norm": 0.6916398406028748,
      "learning_rate": 5.228664126257138e-06,
      "loss": 0.1471,
      "mae_dtheta": 0.03710707277059555,
      "mae_dx": 0.01112274918705225,
      "mae_dy": 0.005561165977269411,
      "pose_mae_dtheta": 0.3084331154823303,
      "pose_mae_dx": 0.09900347143411636,
      "pose_mae_dy": 0.04801171272993088,
      "pose_rmse_dtheta": 0.49549755454063416,
      "pose_rmse_dx": 0.200466126203537,
      "pose_rmse_dy": 0.10228578746318817,
      "pose_rmse_mean": 0.2660831809043884,
      "rmse_dtheta": 0.052995067089796066,
      "rmse_dx": 0.02153373323380947,
      "rmse_dy": 0.012165429070591927,
      "rmse_mean": 0.028898075222969055,
      "rotation_flip": 0.007923929952085018,
      "sparse_tokens": 10690.0,
      "step": 5888,
      "turn_loss": 0.2906419336795807,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2736015610481323,
      "grad_norm": 0.43823617696762085,
      "learning_rate": 5.227343282575574e-06,
      "loss": 0.1078,
      "mae_dtheta": 0.012320991605520248,
      "mae_dx": 0.0017623351886868477,
      "mae_dy": 0.0028882066253572702,
      "pose_mae_dtheta": 0.08553890883922577,
      "pose_mae_dx": 0.024747993797063828,
      "pose_mae_dy": 0.030594348907470703,
      "pose_rmse_dtheta": 0.2261197417974472,
      "pose_rmse_dx": 0.06330861151218414,
      "pose_rmse_dy": 0.07085580378770828,
      "pose_rmse_mean": 0.12009471654891968,
      "rmse_dtheta": 0.02688608691096306,
      "rmse_dx": 0.0049081407487392426,
      "rmse_dy": 0.006336272694170475,
      "rmse_mean": 0.012710167095065117,
      "rotation_flip": 0.00800000037997961,
      "sparse_tokens": 32105.0,
      "step": 5889,
      "turn_loss": 0.10877237468957901,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2736480208139751,
      "grad_norm": 0.4259853661060333,
      "learning_rate": 5.2260224229957735e-06,
      "loss": 0.1361,
      "mae_dtheta": 0.006930798292160034,
      "mae_dx": 0.001202515559270978,
      "mae_dy": 0.0016899009933695197,
      "pose_mae_dtheta": 0.04375549405813217,
      "pose_mae_dx": 0.017226584255695343,
      "pose_mae_dy": 0.020624563097953796,
      "pose_rmse_dtheta": 0.1072596088051796,
      "pose_rmse_dx": 0.04817095398902893,
      "pose_rmse_dy": 0.05137234553694725,
      "pose_rmse_mean": 0.06893430650234222,
      "rmse_dtheta": 0.018321294337511063,
      "rmse_dx": 0.0035201460123062134,
      "rmse_dy": 0.004076266195625067,
      "rmse_mean": 0.008639235980808735,
      "rotation_flip": 0.0013636363437399268,
      "sparse_tokens": 32089.0,
      "step": 5890,
      "turn_loss": 0.06080752611160278,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.2736944805798179,
      "grad_norm": 0.4435330927371979,
      "learning_rate": 5.2247015476101025e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.026817766949534416,
      "mae_dx": 0.009217973798513412,
      "mae_dy": 0.004653118550777435,
      "pose_mae_dtheta": 0.18729323148727417,
      "pose_mae_dx": 0.06913723051548004,
      "pose_mae_dy": 0.04335002228617668,
      "pose_rmse_dtheta": 0.3388584852218628,
      "pose_rmse_dx": 0.15745550394058228,
      "pose_rmse_dy": 0.10155472159385681,
      "pose_rmse_mean": 0.19928956031799316,
      "rmse_dtheta": 0.04465474560856819,
      "rmse_dx": 0.02058437466621399,
      "rmse_dy": 0.009870648384094238,
      "rmse_mean": 0.025036588311195374,
      "rotation_flip": 0.01955990307033062,
      "sparse_tokens": 6156.0,
      "step": 5891,
      "turn_loss": 0.3137305676937103,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.27374094034566065,
      "grad_norm": 0.5259066820144653,
      "learning_rate": 5.223380656510933e-06,
      "loss": 0.1233,
      "mae_dtheta": 0.011405120603740215,
      "mae_dx": 0.001923206029459834,
      "mae_dy": 0.002732951194047928,
      "pose_mae_dtheta": 0.0731968805193901,
      "pose_mae_dx": 0.025146670639514923,
      "pose_mae_dy": 0.029708418995141983,
      "pose_rmse_dtheta": 0.1708962619304657,
      "pose_rmse_dx": 0.0638437420129776,
      "pose_rmse_dy": 0.06131424009799957,
      "pose_rmse_mean": 0.09868475049734116,
      "rmse_dtheta": 0.023356929421424866,
      "rmse_dx": 0.005233627278357744,
      "rmse_dy": 0.005855192895978689,
      "rmse_mean": 0.011481916531920433,
      "rotation_flip": 0.008011145517230034,
      "sparse_tokens": 32105.0,
      "step": 5892,
      "turn_loss": 0.08708071708679199,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.27378740011150343,
      "grad_norm": 0.424637109041214,
      "learning_rate": 5.2220597497906315e-06,
      "loss": 0.0799,
      "mae_dtheta": 0.011479204520583153,
      "mae_dx": 0.002622306812554598,
      "mae_dy": 0.001758899656124413,
      "pose_mae_dtheta": 0.07644625008106232,
      "pose_mae_dx": 0.02584563009440899,
      "pose_mae_dy": 0.026187943294644356,
      "pose_rmse_dtheta": 0.1760289967060089,
      "pose_rmse_dx": 0.07626733928918839,
      "pose_rmse_dy": 0.05535157769918442,
      "pose_rmse_mean": 0.10254930704832077,
      "rmse_dtheta": 0.024512607604265213,
      "rmse_dx": 0.008682738058269024,
      "rmse_dy": 0.003371303668245673,
      "rmse_mean": 0.012188883498311043,
      "rotation_flip": 0.0049683828838169575,
      "sparse_tokens": 32073.0,
      "step": 5893,
      "turn_loss": 0.09847437590360641,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.2738338598773462,
      "grad_norm": 0.6244593262672424,
      "learning_rate": 5.220738827541575e-06,
      "loss": 0.1326,
      "mae_dtheta": 0.03365226462483406,
      "mae_dx": 0.011998682282865047,
      "mae_dy": 0.005259559489786625,
      "pose_mae_dtheta": 0.2647610306739807,
      "pose_mae_dx": 0.10116603225469589,
      "pose_mae_dy": 0.07967730611562729,
      "pose_rmse_dtheta": 0.45553234219551086,
      "pose_rmse_dx": 0.21372562646865845,
      "pose_rmse_dy": 0.16334493458271027,
      "pose_rmse_mean": 0.2775343060493469,
      "rmse_dtheta": 0.05082898214459419,
      "rmse_dx": 0.02458169311285019,
      "rmse_dy": 0.009228209964931011,
      "rmse_mean": 0.028212962672114372,
      "rotation_flip": 0.010897436179220676,
      "sparse_tokens": 26578.0,
      "step": 5894,
      "turn_loss": 0.2625870704650879,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.273880319643189,
      "grad_norm": 0.40327656269073486,
      "learning_rate": 5.219417889856133e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.03012288548052311,
      "mae_dx": 0.011333869770169258,
      "mae_dy": 0.004666138906031847,
      "pose_mae_dtheta": 0.24693748354911804,
      "pose_mae_dx": 0.08715663850307465,
      "pose_mae_dy": 0.07105080783367157,
      "pose_rmse_dtheta": 0.45063138008117676,
      "pose_rmse_dx": 0.19686561822891235,
      "pose_rmse_dy": 0.18905982375144958,
      "pose_rmse_mean": 0.27885228395462036,
      "rmse_dtheta": 0.047743357717990875,
      "rmse_dx": 0.02444835565984249,
      "rmse_dy": 0.01027837023139,
      "rmse_mean": 0.027490030974149704,
      "rotation_flip": 0.00917431153357029,
      "sparse_tokens": 8715.0,
      "step": 5895,
      "turn_loss": 0.2117786854505539,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.27392677940903176,
      "grad_norm": 1.3096390962600708,
      "learning_rate": 5.218096936826681e-06,
      "loss": 0.2063,
      "mae_dtheta": 0.034310076385736465,
      "mae_dx": 0.009636187925934792,
      "mae_dy": 0.0030751072335988283,
      "pose_mae_dtheta": 0.26803672313690186,
      "pose_mae_dx": 0.07875403016805649,
      "pose_mae_dy": 0.03776418790221214,
      "pose_rmse_dtheta": 0.5335426330566406,
      "pose_rmse_dx": 0.20125994086265564,
      "pose_rmse_dy": 0.08404356241226196,
      "pose_rmse_mean": 0.2729487419128418,
      "rmse_dtheta": 0.05555347725749016,
      "rmse_dx": 0.0210158359259367,
      "rmse_dy": 0.006510504987090826,
      "rmse_mean": 0.02769327163696289,
      "rotation_flip": 0.024128686636686325,
      "sparse_tokens": 14393.0,
      "step": 5896,
      "turn_loss": 0.18178346753120422,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.27397323917487454,
      "grad_norm": 0.516187310218811,
      "learning_rate": 5.216775968545592e-06,
      "loss": 0.1324,
      "mae_dtheta": 0.02509397640824318,
      "mae_dx": 0.009636148810386658,
      "mae_dy": 0.0035547534935176373,
      "pose_mae_dtheta": 0.21186961233615875,
      "pose_mae_dx": 0.07227548211812973,
      "pose_mae_dy": 0.051028646528720856,
      "pose_rmse_dtheta": 0.4079294800758362,
      "pose_rmse_dx": 0.16647568345069885,
      "pose_rmse_dy": 0.11292078346014023,
      "pose_rmse_mean": 0.22910866141319275,
      "rmse_dtheta": 0.04320994019508362,
      "rmse_dx": 0.021721787750720978,
      "rmse_dy": 0.006842209026217461,
      "rmse_mean": 0.02392464689910412,
      "rotation_flip": 0.012558870017528534,
      "sparse_tokens": 11710.0,
      "step": 5897,
      "turn_loss": 0.17358629405498505,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2740196989407173,
      "grad_norm": 0.6588805913925171,
      "learning_rate": 5.215454985105244e-06,
      "loss": 0.1994,
      "mae_dtheta": 0.009264705702662468,
      "mae_dx": 0.00422949343919754,
      "mae_dy": 0.0013365579070523381,
      "pose_mae_dtheta": 0.06966600567102432,
      "pose_mae_dx": 0.03473872318863869,
      "pose_mae_dy": 0.01284437719732523,
      "pose_rmse_dtheta": 0.24373747408390045,
      "pose_rmse_dx": 0.11330744624137878,
      "pose_rmse_dy": 0.05466274172067642,
      "pose_rmse_mean": 0.13723589479923248,
      "rmse_dtheta": 0.028695417568087578,
      "rmse_dx": 0.013056617230176926,
      "rmse_dy": 0.005502052139490843,
      "rmse_mean": 0.015751361846923828,
      "rotation_flip": 0.009153317660093307,
      "sparse_tokens": 32121.0,
      "step": 5898,
      "turn_loss": 0.10861361771821976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2740661587065601,
      "grad_norm": 0.4645150303840637,
      "learning_rate": 5.214133986598014e-06,
      "loss": 0.0776,
      "mae_dtheta": 0.012121139094233513,
      "mae_dx": 0.0019079074263572693,
      "mae_dy": 0.0027956946287304163,
      "pose_mae_dtheta": 0.08527763187885284,
      "pose_mae_dx": 0.029264504089951515,
      "pose_mae_dy": 0.03365758806467056,
      "pose_rmse_dtheta": 0.21903683245182037,
      "pose_rmse_dx": 0.07912576198577881,
      "pose_rmse_dy": 0.0887228474020958,
      "pose_rmse_mean": 0.12896181643009186,
      "rmse_dtheta": 0.027301568537950516,
      "rmse_dx": 0.005177293438464403,
      "rmse_dy": 0.006709887646138668,
      "rmse_mean": 0.013062916696071625,
      "rotation_flip": 0.0026565464213490486,
      "sparse_tokens": 32121.0,
      "step": 5899,
      "turn_loss": 0.08751097321510315,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2741126184724029,
      "grad_norm": 0.550053060054779,
      "learning_rate": 5.212812973116277e-06,
      "loss": 0.117,
      "mae_dtheta": 0.007861653342843056,
      "mae_dx": 0.0016807657666504383,
      "mae_dy": 0.0013597439974546432,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5500532388687134,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.4327850341797,
      "model/head/act_norm_mean": 116.54918323863636,
      "model/head/act_norm_min": 73.56170654296875,
      "model/head/act_over_embed": 80.09368987223574,
      "model/head/grad_frac": 0.1114620715379715,
      "model/head/grad_norm": 0.061310071498155594,
      "model/head/grad_zero_frac": 0.000174182205228135,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7020596590909091,
      "model/head/update_ratio": 0.001047751633450389,
      "model/head/weight_delta": 8.872425079345703,
      "model/head/weight_delta_rel": 0.1556486189365387,
      "model/head/weight_norm": 58.51584243774414,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42085719108581543,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42078339160801553,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4207082688808441,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28916628614920736,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08633006364107132,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04748613014817238,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5506177725770925,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015349077293649316,
      "model/modality_embedder.encoders.pose/weight_delta": 2.886012315750122,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09429501742124557,
      "model/modality_embedder.encoders.pose/weight_norm": 30.937448501586914,
      "model/modality_embedder/grad_frac": 0.08633006364107132,
      "model/modality_embedder/grad_norm": 0.04748613014817238,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5506177725770925,
      "model/modality_embedder/update_ratio": 0.0015349077293649316,
      "model/modality_embedder/weight_delta": 2.886012315750122,
      "model/modality_embedder/weight_delta_rel": 0.09429501742124557,
      "model/modality_embedder/weight_norm": 30.937448501586914,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.97976684570312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.257427950136282,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.024632453918457,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.669931588952167,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08694338798522949,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04782349243760109,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017168432241305709,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.2542245388031006,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08214530348777771,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.855480194091797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.59612274169922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.314677028218696,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.284957885742188,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.39648305353222,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0909164696931839,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.050008900463581085,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016897167079150677,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.8563804626464844,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09894724935293198,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.596027374267578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.35284423828125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.202378447170116,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.298883438110352,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.69372914157476,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09621813893318176,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.052925098687410355,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001731994329020381,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.079663038253784,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10340932011604309,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.557315826416016,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.985595703125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.929197731281064,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.388132095336914,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.880415520352653,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09813250601291656,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05397810414433479,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018103605834767222,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.629638910293579,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.08986857533454895,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.81621742248535,
      "model/normalizer/grad_frac": 0.35976868867874146,
      "model/normalizer/grad_norm": 0.1978919357061386,
      "model/normalizer/grad_zero_frac": 0.00016189816233236343,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002522112336009741,
      "model/normalizer/weight_delta": 5.571392059326172,
      "model/normalizer/weight_delta_rel": 0.07175630331039429,
      "model/normalizer/weight_norm": 78.46277618408203,
      "pose_mae_dtheta": 0.05739019066095352,
      "pose_mae_dx": 0.020702529698610306,
      "pose_mae_dy": 0.019098151475191116,
      "pose_rmse_dtheta": 0.16832506656646729,
      "pose_rmse_dx": 0.0484771691262722,
      "pose_rmse_dy": 0.04668501392006874,
      "pose_rmse_mean": 0.08782908320426941,
      "rmse_dtheta": 0.020766496658325195,
      "rmse_dx": 0.004628040827810764,
      "rmse_dy": 0.003248305991292,
      "rmse_mean": 0.009547614492475986,
      "rotation_flip": 0.006100217811763287,
      "sparse_tokens": 32137.0,
      "step": 5900,
      "turn_loss": 0.06456897407770157,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2741590782382457,
      "grad_norm": 0.6259996891021729,
      "learning_rate": 5.2114919447524155e-06,
      "loss": 0.1823,
      "mae_dtheta": 0.010839313268661499,
      "mae_dx": 0.0027825708966702223,
      "mae_dy": 0.0031566740944981575,
      "pose_mae_dtheta": 0.08014597743749619,
      "pose_mae_dx": 0.029967114329338074,
      "pose_mae_dy": 0.032356735318899155,
      "pose_rmse_dtheta": 0.1930811107158661,
      "pose_rmse_dx": 0.08669713884592056,
      "pose_rmse_dy": 0.08626379817724228,
      "pose_rmse_mean": 0.12201401591300964,
      "rmse_dtheta": 0.0255588386207819,
      "rmse_dx": 0.008475280366837978,
      "rmse_dy": 0.008161690086126328,
      "rmse_mean": 0.014065269380807877,
      "rotation_flip": 0.004187994636595249,
      "sparse_tokens": 32089.0,
      "step": 5901,
      "turn_loss": 0.12079587578773499,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.2742055380040885,
      "grad_norm": 0.4892151653766632,
      "learning_rate": 5.21017090159881e-06,
      "loss": 0.1178,
      "mae_dtheta": 0.038140445947647095,
      "mae_dx": 0.013065007515251637,
      "mae_dy": 0.0031153045129030943,
      "pose_mae_dtheta": 0.3053613305091858,
      "pose_mae_dx": 0.10805654525756836,
      "pose_mae_dy": 0.0478728748857975,
      "pose_rmse_dtheta": 0.5353760123252869,
      "pose_rmse_dx": 0.2115340530872345,
      "pose_rmse_dy": 0.10168911516666412,
      "pose_rmse_mean": 0.2828664183616638,
      "rmse_dtheta": 0.05916176363825798,
      "rmse_dx": 0.025761371478438377,
      "rmse_dy": 0.005706217605620623,
      "rmse_mean": 0.03020978532731533,
      "rotation_flip": 0.00657894741743803,
      "sparse_tokens": 2624.0,
      "step": 5902,
      "turn_loss": 0.25392022728919983,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.27425199776993126,
      "grad_norm": 0.4097382426261902,
      "learning_rate": 5.20884984374784e-06,
      "loss": 0.0623,
      "mae_dtheta": 0.006642453372478485,
      "mae_dx": 0.00246018311008811,
      "mae_dy": 0.0018929803045466542,
      "pose_mae_dtheta": 0.04808860272169113,
      "pose_mae_dx": 0.026844121515750885,
      "pose_mae_dy": 0.022155247628688812,
      "pose_rmse_dtheta": 0.11569052189588547,
      "pose_rmse_dx": 0.0995369553565979,
      "pose_rmse_dy": 0.05950765684247017,
      "pose_rmse_mean": 0.09157838672399521,
      "rmse_dtheta": 0.015573334880173206,
      "rmse_dx": 0.009379370138049126,
      "rmse_dy": 0.00477834977209568,
      "rmse_mean": 0.009910352528095245,
      "rotation_flip": 0.0005605381447821856,
      "sparse_tokens": 32057.0,
      "step": 5903,
      "turn_loss": 0.06214847415685654,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.27429845753577403,
      "grad_norm": 0.5122924447059631,
      "learning_rate": 5.207528771291888e-06,
      "loss": 0.1303,
      "mae_dtheta": 0.03631871938705444,
      "mae_dx": 0.014301651157438755,
      "mae_dy": 0.0047522615641355515,
      "pose_mae_dtheta": 0.29168811440467834,
      "pose_mae_dx": 0.12494238466024399,
      "pose_mae_dy": 0.04548269137740135,
      "pose_rmse_dtheta": 0.5201027393341064,
      "pose_rmse_dx": 0.2602810859680176,
      "pose_rmse_dy": 0.10897060483694077,
      "pose_rmse_mean": 0.29645147919654846,
      "rmse_dtheta": 0.055379316210746765,
      "rmse_dx": 0.027431391179561615,
      "rmse_dy": 0.009380255825817585,
      "rmse_mean": 0.030730322003364563,
      "rotation_flip": 0.0029498524963855743,
      "sparse_tokens": 5255.0,
      "step": 5904,
      "turn_loss": 0.3135354816913605,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.2743449173016168,
      "grad_norm": 0.6807025671005249,
      "learning_rate": 5.206207684323337e-06,
      "loss": 0.1643,
      "mae_dtheta": 0.03277109935879707,
      "mae_dx": 0.01191847212612629,
      "mae_dy": 0.006585321854799986,
      "pose_mae_dtheta": 0.2911166846752167,
      "pose_mae_dx": 0.08954263478517532,
      "pose_mae_dy": 0.07676228135824203,
      "pose_rmse_dtheta": 0.5362721681594849,
      "pose_rmse_dx": 0.20302149653434753,
      "pose_rmse_dy": 0.15634562075138092,
      "pose_rmse_mean": 0.2985464334487915,
      "rmse_dtheta": 0.050927963107824326,
      "rmse_dx": 0.02487502433359623,
      "rmse_dy": 0.012152993120253086,
      "rmse_mean": 0.029318660497665405,
      "rotation_flip": 0.013671875,
      "sparse_tokens": 8956.0,
      "step": 5905,
      "turn_loss": 0.28494763374328613,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.2743913770674596,
      "grad_norm": 0.5636617541313171,
      "learning_rate": 5.204886582934573e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.033225465565919876,
      "mae_dx": 0.005613895133137703,
      "mae_dy": 0.004044574219733477,
      "pose_mae_dtheta": 0.26706114411354065,
      "pose_mae_dx": 0.04705144464969635,
      "pose_mae_dy": 0.07366454601287842,
      "pose_rmse_dtheta": 0.43196433782577515,
      "pose_rmse_dx": 0.08841989189386368,
      "pose_rmse_dy": 0.16686630249023438,
      "pose_rmse_mean": 0.22908352315425873,
      "rmse_dtheta": 0.051873523741960526,
      "rmse_dx": 0.013156721368432045,
      "rmse_dy": 0.008067628368735313,
      "rmse_mean": 0.02436595968902111,
      "rotation_flip": 0.014204545877873898,
      "sparse_tokens": 5368.0,
      "step": 5906,
      "turn_loss": 0.2569282650947571,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.27443783683330236,
      "grad_norm": 0.6765699982643127,
      "learning_rate": 5.20356546721798e-06,
      "loss": 0.1429,
      "mae_dtheta": 0.03498731553554535,
      "mae_dx": 0.00980629026889801,
      "mae_dy": 0.004803999327123165,
      "pose_mae_dtheta": 0.28183305263519287,
      "pose_mae_dx": 0.07753679156303406,
      "pose_mae_dy": 0.05672835186123848,
      "pose_rmse_dtheta": 0.489540159702301,
      "pose_rmse_dx": 0.19583985209465027,
      "pose_rmse_dy": 0.1408601999282837,
      "pose_rmse_mean": 0.2754133939743042,
      "rmse_dtheta": 0.05282103642821312,
      "rmse_dx": 0.02266840822994709,
      "rmse_dy": 0.010554577223956585,
      "rmse_mean": 0.02868134155869484,
      "rotation_flip": 0.01590271294116974,
      "sparse_tokens": 18041.0,
      "step": 5907,
      "turn_loss": 0.2690340280532837,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.27448429659914514,
      "grad_norm": 0.4325302839279175,
      "learning_rate": 5.202244337265945e-06,
      "loss": 0.0859,
      "mae_dtheta": 0.010842876508831978,
      "mae_dx": 0.0016888434765860438,
      "mae_dy": 0.0028903656639158726,
      "pose_mae_dtheta": 0.07222297787666321,
      "pose_mae_dx": 0.025546368211507797,
      "pose_mae_dy": 0.02877282164990902,
      "pose_rmse_dtheta": 0.1625158190727234,
      "pose_rmse_dx": 0.059959713369607925,
      "pose_rmse_dy": 0.06063467264175415,
      "pose_rmse_mean": 0.09437006711959839,
      "rmse_dtheta": 0.023143760859966278,
      "rmse_dx": 0.004664558917284012,
      "rmse_dy": 0.0060090310871601105,
      "rmse_mean": 0.011272450909018517,
      "rotation_flip": 0.006426735315471888,
      "sparse_tokens": 32121.0,
      "step": 5908,
      "turn_loss": 0.09743714332580566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2745307563649879,
      "grad_norm": 0.48857438564300537,
      "learning_rate": 5.2009231931708535e-06,
      "loss": 0.0724,
      "mae_dtheta": 0.009841243736445904,
      "mae_dx": 0.0016988669522106647,
      "mae_dy": 0.0023564526345580816,
      "pose_mae_dtheta": 0.07156689465045929,
      "pose_mae_dx": 0.022455831989645958,
      "pose_mae_dy": 0.03092244081199169,
      "pose_rmse_dtheta": 0.18110992014408112,
      "pose_rmse_dx": 0.07535264641046524,
      "pose_rmse_dy": 0.0908353254199028,
      "pose_rmse_mean": 0.11576597392559052,
      "rmse_dtheta": 0.020949145779013634,
      "rmse_dx": 0.005415135063230991,
      "rmse_dy": 0.007018581498414278,
      "rmse_mean": 0.011127620935440063,
      "rotation_flip": 0.006791849620640278,
      "sparse_tokens": 32105.0,
      "step": 5909,
      "turn_loss": 0.08844061940908432,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13605.0,
      "epoch": 0.2745772161308307,
      "grad_norm": 0.5488010048866272,
      "learning_rate": 5.199602035025098e-06,
      "loss": 0.121,
      "mae_dtheta": 0.03034239634871483,
      "mae_dx": 0.01121447328478098,
      "mae_dy": 0.005505423527210951,
      "pose_mae_dtheta": 0.24438996613025665,
      "pose_mae_dx": 0.10733171552419662,
      "pose_mae_dy": 0.07501967251300812,
      "pose_rmse_dtheta": 0.38154345750808716,
      "pose_rmse_dx": 0.2308475226163864,
      "pose_rmse_dy": 0.17177283763885498,
      "pose_rmse_mean": 0.2613879442214966,
      "rmse_dtheta": 0.04235195741057396,
      "rmse_dx": 0.024069037288427353,
      "rmse_dy": 0.010585418902337551,
      "rmse_mean": 0.025668805465102196,
      "rotation_flip": 0.006410256493836641,
      "sparse_tokens": 10239.0,
      "step": 5910,
      "turn_loss": 0.24683800339698792,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 32986.0,
      "epoch": 0.27462367589667347,
      "grad_norm": 1.0192546844482422,
      "learning_rate": 5.198280862921062e-06,
      "loss": 0.2119,
      "mae_dtheta": 0.03055611625313759,
      "mae_dx": 0.011329974047839642,
      "mae_dy": 0.004943522159010172,
      "pose_mae_dtheta": 0.24913540482521057,
      "pose_mae_dx": 0.09738456457853317,
      "pose_mae_dy": 0.064305879175663,
      "pose_rmse_dtheta": 0.4448206424713135,
      "pose_rmse_dx": 0.23871462047100067,
      "pose_rmse_dy": 0.16049601137638092,
      "pose_rmse_mean": 0.2813437581062317,
      "rmse_dtheta": 0.04825476557016373,
      "rmse_dx": 0.02461179345846176,
      "rmse_dy": 0.009873625822365284,
      "rmse_mean": 0.02758006379008293,
      "rotation_flip": 0.008308157324790955,
      "sparse_tokens": 26781.0,
      "step": 5911,
      "turn_loss": 0.23357553780078888,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.27467013566251625,
      "grad_norm": 0.40011391043663025,
      "learning_rate": 5.19695967695114e-06,
      "loss": 0.1021,
      "mae_dtheta": 0.004349881783127785,
      "mae_dx": 0.0008823630050756037,
      "mae_dy": 0.0008581039146520197,
      "pose_mae_dtheta": 0.03427384793758392,
      "pose_mae_dx": 0.00990500021725893,
      "pose_mae_dy": 0.01555444486439228,
      "pose_rmse_dtheta": 0.10963556915521622,
      "pose_rmse_dx": 0.03677889704704285,
      "pose_rmse_dy": 0.059331223368644714,
      "pose_rmse_mean": 0.06858189404010773,
      "rmse_dtheta": 0.014138036407530308,
      "rmse_dx": 0.0031098623294383287,
      "rmse_dy": 0.0028573779854923487,
      "rmse_mean": 0.006701759062707424,
      "rotation_flip": 0.0029821074567735195,
      "sparse_tokens": 32041.0,
      "step": 5912,
      "turn_loss": 0.037352196872234344,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17861.0,
      "epoch": 0.274716595428359,
      "grad_norm": 0.7677463293075562,
      "learning_rate": 5.195638477207722e-06,
      "loss": 0.2491,
      "mae_dtheta": 0.0326526053249836,
      "mae_dx": 0.007330304943025112,
      "mae_dy": 0.004299825988709927,
      "pose_mae_dtheta": 0.23167309165000916,
      "pose_mae_dx": 0.05653145909309387,
      "pose_mae_dy": 0.049790602177381516,
      "pose_rmse_dtheta": 0.4426761269569397,
      "pose_rmse_dx": 0.15848322212696075,
      "pose_rmse_dy": 0.11391949653625488,
      "pose_rmse_mean": 0.23835961520671844,
      "rmse_dtheta": 0.05178628861904144,
      "rmse_dx": 0.017667099833488464,
      "rmse_dy": 0.008832210674881935,
      "rmse_mean": 0.026095200330018997,
      "rotation_flip": 0.016620498150587082,
      "sparse_tokens": 14065.0,
      "step": 5913,
      "turn_loss": 0.25827497243881226,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2747630551942018,
      "grad_norm": 0.6183180809020996,
      "learning_rate": 5.1943172637832006e-06,
      "loss": 0.1476,
      "mae_dtheta": 0.00788738951086998,
      "mae_dx": 0.0011122936848551035,
      "mae_dy": 0.0006463580066338181,
      "pose_mae_dtheta": 0.05911027640104294,
      "pose_mae_dx": 0.01108053419739008,
      "pose_mae_dy": 0.011840608902275562,
      "pose_rmse_dtheta": 0.21272224187850952,
      "pose_rmse_dx": 0.029743043705821037,
      "pose_rmse_dy": 0.036774229258298874,
      "pose_rmse_mean": 0.0930798351764679,
      "rmse_dtheta": 0.025472786277532578,
      "rmse_dx": 0.003716933773830533,
      "rmse_dy": 0.0015939781442284584,
      "rmse_mean": 0.0102612329646945,
      "rotation_flip": 0.0013413815759122372,
      "sparse_tokens": 32089.0,
      "step": 5914,
      "turn_loss": 0.042050573974847794,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.2748095149600446,
      "grad_norm": 0.703930675983429,
      "learning_rate": 5.192996036769969e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.03055662475526333,
      "mae_dx": 0.005878651514649391,
      "mae_dy": 0.0035416402388364077,
      "pose_mae_dtheta": 0.23718194663524628,
      "pose_mae_dx": 0.048431310802698135,
      "pose_mae_dy": 0.04459124803543091,
      "pose_rmse_dtheta": 0.39191803336143494,
      "pose_rmse_dx": 0.12332644313573837,
      "pose_rmse_dy": 0.11361170560121536,
      "pose_rmse_mean": 0.2096187323331833,
      "rmse_dtheta": 0.0455327183008194,
      "rmse_dx": 0.014807472936809063,
      "rmse_dy": 0.007758377585560083,
      "rmse_mean": 0.022699523717164993,
      "rotation_flip": 0.017191976308822632,
      "sparse_tokens": 6282.0,
      "step": 5915,
      "turn_loss": 0.21240901947021484,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.2748559747258874,
      "grad_norm": 0.565075695514679,
      "learning_rate": 5.19167479626042e-06,
      "loss": 0.1647,
      "mae_dtheta": 0.04606863856315613,
      "mae_dx": 0.01548980362713337,
      "mae_dy": 0.005782105028629303,
      "pose_mae_dtheta": 0.39841240644454956,
      "pose_mae_dx": 0.12143551558256149,
      "pose_mae_dy": 0.09591630101203918,
      "pose_rmse_dtheta": 0.6704281568527222,
      "pose_rmse_dx": 0.25788944959640503,
      "pose_rmse_dy": 0.23294849693775177,
      "pose_rmse_mean": 0.38708871603012085,
      "rmse_dtheta": 0.06627675145864487,
      "rmse_dx": 0.029936982318758965,
      "rmse_dy": 0.010954046621918678,
      "rmse_mean": 0.03572259470820427,
      "rotation_flip": 0.004126547370105982,
      "sparse_tokens": 11863.0,
      "step": 5916,
      "turn_loss": 0.292380154132843,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.2749024344917302,
      "grad_norm": 1.3647304773330688,
      "learning_rate": 5.190353542346951e-06,
      "loss": 0.295,
      "mae_dtheta": 0.025823889300227165,
      "mae_dx": 0.00507119856774807,
      "mae_dy": 0.005353986751288176,
      "pose_mae_dtheta": 0.15374259650707245,
      "pose_mae_dx": 0.03873579576611519,
      "pose_mae_dy": 0.0726507157087326,
      "pose_rmse_dtheta": 0.22896702587604523,
      "pose_rmse_dx": 0.06834296882152557,
      "pose_rmse_dy": 0.12026378512382507,
      "pose_rmse_mean": 0.13919126987457275,
      "rmse_dtheta": 0.0348559245467186,
      "rmse_dx": 0.011902210302650928,
      "rmse_dy": 0.007665857672691345,
      "rmse_mean": 0.018141331151127815,
      "rotation_flip": 0.044871795922517776,
      "sparse_tokens": 2585.0,
      "step": 5917,
      "turn_loss": 0.24251040816307068,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.27494889425757296,
      "grad_norm": 0.43569445610046387,
      "learning_rate": 5.189032275121956e-06,
      "loss": 0.124,
      "mae_dtheta": 0.044098880141973495,
      "mae_dx": 0.011182880029082298,
      "mae_dy": 0.005850240588188171,
      "pose_mae_dtheta": 0.36209261417388916,
      "pose_mae_dx": 0.09086472541093826,
      "pose_mae_dy": 0.06345818936824799,
      "pose_rmse_dtheta": 0.659475564956665,
      "pose_rmse_dx": 0.21990031003952026,
      "pose_rmse_dy": 0.13419105112552643,
      "pose_rmse_mean": 0.33785566687583923,
      "rmse_dtheta": 0.06648656725883484,
      "rmse_dx": 0.024627262726426125,
      "rmse_dy": 0.01268944051116705,
      "rmse_mean": 0.03460109233856201,
      "rotation_flip": 0.010204081423580647,
      "sparse_tokens": 9244.0,
      "step": 5918,
      "turn_loss": 0.3161948025226593,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.27499535402341574,
      "grad_norm": 0.6269080638885498,
      "learning_rate": 5.1877109946778315e-06,
      "loss": 0.1373,
      "mae_dtheta": 0.03999004513025284,
      "mae_dx": 0.008756288327276707,
      "mae_dy": 0.003098686458542943,
      "pose_mae_dtheta": 0.3254512846469879,
      "pose_mae_dx": 0.06990581750869751,
      "pose_mae_dy": 0.043679263442754745,
      "pose_rmse_dtheta": 0.5357884764671326,
      "pose_rmse_dx": 0.16598112881183624,
      "pose_rmse_dy": 0.09565502405166626,
      "pose_rmse_mean": 0.26580822467803955,
      "rmse_dtheta": 0.057026207447052,
      "rmse_dx": 0.019957290962338448,
      "rmse_dy": 0.006085493601858616,
      "rmse_mean": 0.02768966369330883,
      "rotation_flip": 0.007104795891791582,
      "sparse_tokens": 9490.0,
      "step": 5919,
      "turn_loss": 0.2871425151824951,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2750418137892585,
      "grad_norm": 0.5431944131851196,
      "learning_rate": 5.1863897011069775e-06,
      "loss": 0.0843,
      "mae_dtheta": 0.007326990365982056,
      "mae_dx": 0.001114093465730548,
      "mae_dy": 0.00106124731246382,
      "pose_mae_dtheta": 0.054468799382448196,
      "pose_mae_dx": 0.010241502895951271,
      "pose_mae_dy": 0.011236336082220078,
      "pose_rmse_dtheta": 0.21509002149105072,
      "pose_rmse_dx": 0.029265813529491425,
      "pose_rmse_dy": 0.028481047600507736,
      "pose_rmse_mean": 0.09094562381505966,
      "rmse_dtheta": 0.02369184046983719,
      "rmse_dx": 0.0038615725934505463,
      "rmse_dy": 0.0028348404448479414,
      "rmse_mean": 0.010129418224096298,
      "rotation_flip": 0.005044136196374893,
      "sparse_tokens": 32073.0,
      "step": 5920,
      "turn_loss": 0.042763594537973404,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2750882735551013,
      "grad_norm": 0.41977155208587646,
      "learning_rate": 5.185068394501791e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.007558851037174463,
      "mae_dx": 0.0015057260170578957,
      "mae_dy": 0.0011828948045149446,
      "pose_mae_dtheta": 0.056813955307006836,
      "pose_mae_dx": 0.016574835404753685,
      "pose_mae_dy": 0.015055821277201176,
      "pose_rmse_dtheta": 0.2045452892780304,
      "pose_rmse_dx": 0.04591340199112892,
      "pose_rmse_dy": 0.04109254851937294,
      "pose_rmse_mean": 0.09718374907970428,
      "rmse_dtheta": 0.023201923817396164,
      "rmse_dx": 0.005073609761893749,
      "rmse_dy": 0.003320891410112381,
      "rmse_mean": 0.010532142594456673,
      "rotation_flip": 0.0028216703794896603,
      "sparse_tokens": 32121.0,
      "step": 5921,
      "turn_loss": 0.05795186758041382,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14898.0,
      "epoch": 0.27513473332094407,
      "grad_norm": 0.5446189641952515,
      "learning_rate": 5.183747074954673e-06,
      "loss": 0.132,
      "mae_dtheta": 0.027427954599261284,
      "mae_dx": 0.012262686155736446,
      "mae_dy": 0.004220887552946806,
      "pose_mae_dtheta": 0.21921226382255554,
      "pose_mae_dx": 0.09344104677438736,
      "pose_mae_dy": 0.05784136801958084,
      "pose_rmse_dtheta": 0.41186752915382385,
      "pose_rmse_dx": 0.21049809455871582,
      "pose_rmse_dy": 0.12758426368236542,
      "pose_rmse_mean": 0.2499832957983017,
      "rmse_dtheta": 0.04464806616306305,
      "rmse_dx": 0.025563731789588928,
      "rmse_dy": 0.007984774187207222,
      "rmse_mean": 0.02606552466750145,
      "rotation_flip": 0.013293944299221039,
      "sparse_tokens": 12237.0,
      "step": 5922,
      "turn_loss": 0.2051897943019867,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.27518119308678685,
      "grad_norm": 0.7333093285560608,
      "learning_rate": 5.182425742558024e-06,
      "loss": 0.1563,
      "mae_dtheta": 0.013427321799099445,
      "mae_dx": 0.003787130583077669,
      "mae_dy": 0.004701556172221899,
      "pose_mae_dtheta": 0.09114361554384232,
      "pose_mae_dx": 0.04141721501946449,
      "pose_mae_dy": 0.040135227143764496,
      "pose_rmse_dtheta": 0.1849149614572525,
      "pose_rmse_dx": 0.10561580955982208,
      "pose_rmse_dy": 0.09560703486204147,
      "pose_rmse_mean": 0.12871260941028595,
      "rmse_dtheta": 0.025928907096385956,
      "rmse_dx": 0.009752494283020496,
      "rmse_dy": 0.01045132614672184,
      "rmse_mean": 0.01537757646292448,
      "rotation_flip": 0.006990881636738777,
      "sparse_tokens": 32169.0,
      "step": 5923,
      "turn_loss": 0.15247532725334167,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2752276528526296,
      "grad_norm": 0.4309588372707367,
      "learning_rate": 5.181104397404243e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.00597407016903162,
      "mae_dx": 0.0012941998429596424,
      "mae_dy": 0.0013890410773456097,
      "pose_mae_dtheta": 0.04225793853402138,
      "pose_mae_dx": 0.013561904430389404,
      "pose_mae_dy": 0.014618041925132275,
      "pose_rmse_dtheta": 0.1488877385854721,
      "pose_rmse_dx": 0.044228218495845795,
      "pose_rmse_dy": 0.03653709217905998,
      "pose_rmse_mean": 0.07655102014541626,
      "rmse_dtheta": 0.016377801075577736,
      "rmse_dx": 0.004240569658577442,
      "rmse_dy": 0.003901081159710884,
      "rmse_mean": 0.008173150941729546,
      "rotation_flip": 0.0023781212512403727,
      "sparse_tokens": 32073.0,
      "step": 5924,
      "turn_loss": 0.04868360981345177,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.2752741126184724,
      "grad_norm": 1.8686482906341553,
      "learning_rate": 5.179783039585735e-06,
      "loss": 0.2066,
      "mae_dtheta": 0.03170904889702797,
      "mae_dx": 0.006609458476305008,
      "mae_dy": 0.0034949076361954212,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.999999463558197,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.2082061767578,
      "model/head/act_norm_mean": 107.01422614020271,
      "model/head/act_norm_min": 53.49506378173828,
      "model/head/act_over_embed": 73.54117808651735,
      "model/head/grad_frac": 0.07076500356197357,
      "model/head/grad_norm": 0.07076496630907059,
      "model/head/grad_zero_frac": 9.042245801538229e-05,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6898754222972973,
      "model/head/update_ratio": 0.001209267065860331,
      "model/head/weight_delta": 8.886730194091797,
      "model/head/weight_delta_rel": 0.15589956939220428,
      "model/head/weight_norm": 58.518890380859375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4208417236804962,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42080886740433543,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42074084281921387,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28918379335494654,
      "model/modality_embedder.encoders.pose/grad_frac": 0.24055224657058716,
      "model/modality_embedder.encoders.pose/grad_norm": 0.2405521124601364,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5427631578947368,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0077752419747412205,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8905043601989746,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09444178640842438,
      "model/modality_embedder.encoders.pose/weight_norm": 30.938215255737305,
      "model/modality_embedder/grad_frac": 0.24055224657058716,
      "model/modality_embedder/grad_norm": 0.2405521124601364,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5427631578947368,
      "model/modality_embedder/update_ratio": 0.0077752419747412205,
      "model/modality_embedder/weight_delta": 2.8905043601989746,
      "model/modality_embedder/weight_delta_rel": 0.09444178640842438,
      "model/modality_embedder/weight_norm": 30.938215255737305,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.09162139892578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.344003043221793,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.139184951782227,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.04221744130182,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.04497786611318588,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04497784376144409,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016146121779456735,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.259669303894043,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08234371244907379,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.856746673583984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.49222564697266,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.166767213642213,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.731208801269531,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.607628682054255,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.044577132910490036,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.044577110558748245,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015060813166201115,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.86310076713562,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09918005019426346,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.59807586669922,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.4369125366211,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.83155365186615,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.507753372192383,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.751685508377943,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.04421894624829292,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04421892389655113,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014469720190390944,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.0871739387512207,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10366152226924896,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.55962562561035,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.01531219482422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.719542645323894,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.585549354553223,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.049129220313542,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.038356781005859375,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.038356758654117584,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 7.565364649053663e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012863697484135628,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.636211633682251,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0900932028889656,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.817832946777344,
      "model/normalizer/grad_frac": 0.14277110993862152,
      "model/normalizer/grad_norm": 0.14277103543281555,
      "model/normalizer/grad_zero_frac": 0.00011699210153892636,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018195442389696836,
      "model/normalizer/weight_delta": 5.584928512573242,
      "model/normalizer/weight_delta_rel": 0.0719306468963623,
      "model/normalizer/weight_norm": 78.46527099609375,
      "pose_mae_dtheta": 0.25842103362083435,
      "pose_mae_dx": 0.04917605593800545,
      "pose_mae_dy": 0.04686405137181282,
      "pose_rmse_dtheta": 0.44543349742889404,
      "pose_rmse_dx": 0.13561737537384033,
      "pose_rmse_dy": 0.1185285821557045,
      "pose_rmse_mean": 0.23319315910339355,
      "rmse_dtheta": 0.04932079836726189,
      "rmse_dx": 0.015947159379720688,
      "rmse_dy": 0.006756099406629801,
      "rmse_mean": 0.024008018895983696,
      "rotation_flip": 0.009225091896951199,
      "sparse_tokens": 9652.0,
      "step": 5925,
      "turn_loss": 0.24730215966701508,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2753205723843152,
      "grad_norm": 0.4767565429210663,
      "learning_rate": 5.178461669194903e-06,
      "loss": 0.107,
      "mae_dtheta": 0.008459196425974369,
      "mae_dx": 0.003506020875647664,
      "mae_dy": 0.0014543426223099232,
      "pose_mae_dtheta": 0.05633528158068657,
      "pose_mae_dx": 0.03271187096834183,
      "pose_mae_dy": 0.01512532215565443,
      "pose_rmse_dtheta": 0.17647762596607208,
      "pose_rmse_dx": 0.07578069716691971,
      "pose_rmse_dy": 0.03860872983932495,
      "pose_rmse_mean": 0.09695568680763245,
      "rmse_dtheta": 0.024452755227684975,
      "rmse_dx": 0.008712186478078365,
      "rmse_dy": 0.003994096536189318,
      "rmse_mean": 0.012386346235871315,
      "rotation_flip": 0.0035070141311734915,
      "sparse_tokens": 32185.0,
      "step": 5926,
      "turn_loss": 0.10413751751184464,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.27536703215015795,
      "grad_norm": 0.7889384031295776,
      "learning_rate": 5.177140286324151e-06,
      "loss": 0.1442,
      "mae_dtheta": 0.007572299335151911,
      "mae_dx": 0.00205290992744267,
      "mae_dy": 0.0011429876321926713,
      "pose_mae_dtheta": 0.0529165118932724,
      "pose_mae_dx": 0.019602002575993538,
      "pose_mae_dy": 0.015424647368490696,
      "pose_rmse_dtheta": 0.1634431630373001,
      "pose_rmse_dx": 0.055735278874635696,
      "pose_rmse_dy": 0.045566625893116,
      "pose_rmse_mean": 0.0882483571767807,
      "rmse_dtheta": 0.021575070917606354,
      "rmse_dx": 0.006767428945749998,
      "rmse_dy": 0.0038318135775625706,
      "rmse_mean": 0.01072477176785469,
      "rotation_flip": 0.005154639016836882,
      "sparse_tokens": 32089.0,
      "step": 5927,
      "turn_loss": 0.057441435754299164,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.27541349191600073,
      "grad_norm": 0.5744335651397705,
      "learning_rate": 5.175818891065883e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.033265337347984314,
      "mae_dx": 0.00731161143630743,
      "mae_dy": 0.009303499944508076,
      "pose_mae_dtheta": 0.2558498978614807,
      "pose_mae_dx": 0.07382237911224365,
      "pose_mae_dy": 0.09735114127397537,
      "pose_rmse_dtheta": 0.4884793162345886,
      "pose_rmse_dx": 0.19976218044757843,
      "pose_rmse_dy": 0.33096185326576233,
      "pose_rmse_mean": 0.33973443508148193,
      "rmse_dtheta": 0.05217771604657173,
      "rmse_dx": 0.014608662575483322,
      "rmse_dy": 0.023132314905524254,
      "rmse_mean": 0.029972899705171585,
      "rotation_flip": 0.01230769231915474,
      "sparse_tokens": 5140.0,
      "step": 5928,
      "turn_loss": 0.3141786754131317,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2754599516818435,
      "grad_norm": 0.4282926023006439,
      "learning_rate": 5.174497483512506e-06,
      "loss": 0.1342,
      "mae_dtheta": 0.0072398716583848,
      "mae_dx": 0.001468729693442583,
      "mae_dy": 0.002061807317659259,
      "pose_mae_dtheta": 0.047218821942806244,
      "pose_mae_dx": 0.020118582993745804,
      "pose_mae_dy": 0.023293310776352882,
      "pose_rmse_dtheta": 0.09374447911977768,
      "pose_rmse_dx": 0.05298087000846863,
      "pose_rmse_dy": 0.056143201887607574,
      "pose_rmse_mean": 0.06762285530567169,
      "rmse_dtheta": 0.014579474925994873,
      "rmse_dx": 0.0039670136757195,
      "rmse_dy": 0.004405402112752199,
      "rmse_mean": 0.007650630082935095,
      "rotation_flip": 0.0026395174209028482,
      "sparse_tokens": 32121.0,
      "step": 5929,
      "turn_loss": 0.05558592826128006,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35902.0,
      "epoch": 0.2755064114476863,
      "grad_norm": 0.6526682376861572,
      "learning_rate": 5.173176063756427e-06,
      "loss": 0.208,
      "mae_dtheta": 0.03603065386414528,
      "mae_dx": 0.014176853932440281,
      "mae_dy": 0.005146583076566458,
      "pose_mae_dtheta": 0.2913981080055237,
      "pose_mae_dx": 0.11302632838487625,
      "pose_mae_dy": 0.06349458545446396,
      "pose_rmse_dtheta": 0.5287966132164001,
      "pose_rmse_dx": 0.2567795515060425,
      "pose_rmse_dy": 0.14087018370628357,
      "pose_rmse_mean": 0.30881544947624207,
      "rmse_dtheta": 0.054184671491384506,
      "rmse_dx": 0.027499374002218246,
      "rmse_dy": 0.011258634738624096,
      "rmse_mean": 0.030980892479419708,
      "rotation_flip": 0.011913103982806206,
      "sparse_tokens": 27180.0,
      "step": 5930,
      "turn_loss": 0.28793495893478394,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.27555287121352906,
      "grad_norm": 0.5971898436546326,
      "learning_rate": 5.171854631890049e-06,
      "loss": 0.1216,
      "mae_dtheta": 0.03489391505718231,
      "mae_dx": 0.010248222388327122,
      "mae_dy": 0.0040478575974702835,
      "pose_mae_dtheta": 0.27611666917800903,
      "pose_mae_dx": 0.06567886471748352,
      "pose_mae_dy": 0.0301597211509943,
      "pose_rmse_dtheta": 0.527571976184845,
      "pose_rmse_dx": 0.16306467354297638,
      "pose_rmse_dy": 0.07632172107696533,
      "pose_rmse_mean": 0.2556527853012085,
      "rmse_dtheta": 0.05827657878398895,
      "rmse_dx": 0.021784141659736633,
      "rmse_dy": 0.010182024911046028,
      "rmse_mean": 0.03008091449737549,
      "rotation_flip": 0.02278481051325798,
      "sparse_tokens": 6301.0,
      "step": 5931,
      "turn_loss": 0.22668154537677765,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.27559933097937184,
      "grad_norm": 0.6028176546096802,
      "learning_rate": 5.170533188005788e-06,
      "loss": 0.1422,
      "mae_dtheta": 0.03917260468006134,
      "mae_dx": 0.016346512362360954,
      "mae_dy": 0.005181252956390381,
      "pose_mae_dtheta": 0.29862669110298157,
      "pose_mae_dx": 0.11983884125947952,
      "pose_mae_dy": 0.06827308237552643,
      "pose_rmse_dtheta": 0.48810866475105286,
      "pose_rmse_dx": 0.21750026941299438,
      "pose_rmse_dy": 0.16213877499103546,
      "pose_rmse_mean": 0.2892492413520813,
      "rmse_dtheta": 0.05615587159991264,
      "rmse_dx": 0.02812354825437069,
      "rmse_dy": 0.010848738253116608,
      "rmse_mean": 0.03170938789844513,
      "rotation_flip": 0.013605441898107529,
      "sparse_tokens": 9513.0,
      "step": 5932,
      "turn_loss": 0.2747771143913269,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.27564579074521467,
      "grad_norm": 0.5920549631118774,
      "learning_rate": 5.16921173219605e-06,
      "loss": 0.0886,
      "mae_dtheta": 0.010519091039896011,
      "mae_dx": 0.0013513475423678756,
      "mae_dy": 0.0027120907325297594,
      "pose_mae_dtheta": 0.06730087101459503,
      "pose_mae_dx": 0.02233809232711792,
      "pose_mae_dy": 0.03297596797347069,
      "pose_rmse_dtheta": 0.130349263548851,
      "pose_rmse_dx": 0.055414002388715744,
      "pose_rmse_dy": 0.07197830826044083,
      "pose_rmse_mean": 0.08591385930776596,
      "rmse_dtheta": 0.01992727629840374,
      "rmse_dx": 0.003908553160727024,
      "rmse_dy": 0.005504427943378687,
      "rmse_mean": 0.00978008657693863,
      "rotation_flip": 0.004746257793158293,
      "sparse_tokens": 32025.0,
      "step": 5933,
      "turn_loss": 0.07846710085868835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.27569225051105745,
      "grad_norm": 0.5983603596687317,
      "learning_rate": 5.167890264553243e-06,
      "loss": 0.1252,
      "mae_dtheta": 0.037820231169462204,
      "mae_dx": 0.01126959826797247,
      "mae_dy": 0.0064416080713272095,
      "pose_mae_dtheta": 0.308201402425766,
      "pose_mae_dx": 0.08651496469974518,
      "pose_mae_dy": 0.0535472072660923,
      "pose_rmse_dtheta": 0.5706954002380371,
      "pose_rmse_dx": 0.19355911016464233,
      "pose_rmse_dy": 0.1498071700334549,
      "pose_rmse_mean": 0.3046872317790985,
      "rmse_dtheta": 0.05960657447576523,
      "rmse_dx": 0.02277081087231636,
      "rmse_dy": 0.01515280269086361,
      "rmse_mean": 0.03251006454229355,
      "rotation_flip": 0.008793969638645649,
      "sparse_tokens": 11861.0,
      "step": 5934,
      "turn_loss": 0.2990678548812866,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2757387102769002,
      "grad_norm": 0.5968816876411438,
      "learning_rate": 5.166568785169781e-06,
      "loss": 0.0815,
      "mae_dtheta": 0.008947084657847881,
      "mae_dx": 0.00159783277194947,
      "mae_dy": 0.002210920676589012,
      "pose_mae_dtheta": 0.06477858871221542,
      "pose_mae_dx": 0.01913575455546379,
      "pose_mae_dy": 0.025778548792004585,
      "pose_rmse_dtheta": 0.19048358500003815,
      "pose_rmse_dx": 0.04819827154278755,
      "pose_rmse_dy": 0.06669614464044571,
      "pose_rmse_mean": 0.10179266333580017,
      "rmse_dtheta": 0.02286669611930847,
      "rmse_dx": 0.004373660311102867,
      "rmse_dy": 0.005096693057566881,
      "rmse_mean": 0.010779017582535744,
      "rotation_flip": 0.0017691287212073803,
      "sparse_tokens": 32073.0,
      "step": 5935,
      "turn_loss": 0.081588976085186,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.275785170042743,
      "grad_norm": 0.47134774923324585,
      "learning_rate": 5.165247294138074e-06,
      "loss": 0.0908,
      "mae_dtheta": 0.005857817828655243,
      "mae_dx": 0.001863078330643475,
      "mae_dy": 0.0015970674576237798,
      "pose_mae_dtheta": 0.042145464569330215,
      "pose_mae_dx": 0.018065953627228737,
      "pose_mae_dy": 0.015371871180832386,
      "pose_rmse_dtheta": 0.12109728157520294,
      "pose_rmse_dx": 0.057000432163476944,
      "pose_rmse_dy": 0.0443677194416523,
      "pose_rmse_mean": 0.07415514439344406,
      "rmse_dtheta": 0.01686185598373413,
      "rmse_dx": 0.005867990665137768,
      "rmse_dy": 0.005145958624780178,
      "rmse_mean": 0.009291935712099075,
      "rotation_flip": 0.00500625791028142,
      "sparse_tokens": 32089.0,
      "step": 5936,
      "turn_loss": 0.05382723733782768,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2758316298085858,
      "grad_norm": 0.6107637286186218,
      "learning_rate": 5.163925791550536e-06,
      "loss": 0.0782,
      "mae_dtheta": 0.008006534539163113,
      "mae_dx": 0.001354203443042934,
      "mae_dy": 0.0012216632021591067,
      "pose_mae_dtheta": 0.0519249364733696,
      "pose_mae_dx": 0.014615533873438835,
      "pose_mae_dy": 0.01406308077275753,
      "pose_rmse_dtheta": 0.17639712989330292,
      "pose_rmse_dx": 0.03899069130420685,
      "pose_rmse_dy": 0.038382839411497116,
      "pose_rmse_mean": 0.08459021896123886,
      "rmse_dtheta": 0.021746855229139328,
      "rmse_dx": 0.004099057987332344,
      "rmse_dy": 0.003059313166886568,
      "rmse_mean": 0.0096350759267807,
      "rotation_flip": 0.0031166519038379192,
      "sparse_tokens": 32121.0,
      "step": 5937,
      "turn_loss": 0.06180800870060921,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.27587808957442855,
      "grad_norm": 0.5854823589324951,
      "learning_rate": 5.162604277499578e-06,
      "loss": 0.1448,
      "mae_dtheta": 0.025393906980752945,
      "mae_dx": 0.011919161304831505,
      "mae_dy": 0.003499226877465844,
      "pose_mae_dtheta": 0.20960554480552673,
      "pose_mae_dx": 0.09602312743663788,
      "pose_mae_dy": 0.05918199196457863,
      "pose_rmse_dtheta": 0.3870198428630829,
      "pose_rmse_dx": 0.2158263474702835,
      "pose_rmse_dy": 0.15618203580379486,
      "pose_rmse_mean": 0.2530094385147095,
      "rmse_dtheta": 0.043034378439188004,
      "rmse_dx": 0.02473958395421505,
      "rmse_dy": 0.007545392960309982,
      "rmse_mean": 0.02510645054280758,
      "rotation_flip": 0.017381228506565094,
      "sparse_tokens": 19081.0,
      "step": 5938,
      "turn_loss": 0.21195943653583527,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.27592454934027133,
      "grad_norm": 0.6035346388816833,
      "learning_rate": 5.1612827520776155e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.010235559195280075,
      "mae_dx": 0.0010846864897757769,
      "mae_dy": 0.001710599521175027,
      "pose_mae_dtheta": 0.06760872155427933,
      "pose_mae_dx": 0.01482510194182396,
      "pose_mae_dy": 0.024444380775094032,
      "pose_rmse_dtheta": 0.1933584362268448,
      "pose_rmse_dx": 0.03734336793422699,
      "pose_rmse_dy": 0.05193150416016579,
      "pose_rmse_mean": 0.09421110153198242,
      "rmse_dtheta": 0.02358296327292919,
      "rmse_dx": 0.0031991004943847656,
      "rmse_dy": 0.0038227697368711233,
      "rmse_mean": 0.010201611556112766,
      "rotation_flip": 0.0016528925625607371,
      "sparse_tokens": 32073.0,
      "step": 5939,
      "turn_loss": 0.06911654025316238,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 43489.0,
      "epoch": 0.2759710091061141,
      "grad_norm": 0.7720377445220947,
      "learning_rate": 5.159961215377065e-06,
      "loss": 0.2764,
      "mae_dtheta": 0.03472002595663071,
      "mae_dx": 0.011102156713604927,
      "mae_dy": 0.004130429122596979,
      "pose_mae_dtheta": 0.274196594953537,
      "pose_mae_dx": 0.09019792824983597,
      "pose_mae_dy": 0.04699643701314926,
      "pose_rmse_dtheta": 0.49799129366874695,
      "pose_rmse_dx": 0.2020321488380432,
      "pose_rmse_dy": 0.13720332086086273,
      "pose_rmse_mean": 0.27907559275627136,
      "rmse_dtheta": 0.05437338352203369,
      "rmse_dx": 0.02338651940226555,
      "rmse_dy": 0.010110337287187576,
      "rmse_mean": 0.029290080070495605,
      "rotation_flip": 0.015442208386957645,
      "sparse_tokens": 30289.0,
      "step": 5940,
      "turn_loss": 0.2573571801185608,
      "turns": 134.0,
      "turns_per_sample": 134.0
    },
    {
      "dense_tokens": 32440.0,
      "epoch": 0.2760174688719569,
      "grad_norm": 0.5530920624732971,
      "learning_rate": 5.15863966749034e-06,
      "loss": 0.1682,
      "mae_dtheta": 0.028691161423921585,
      "mae_dx": 0.010587056167423725,
      "mae_dy": 0.005308214109390974,
      "pose_mae_dtheta": 0.20563453435897827,
      "pose_mae_dx": 0.09014720469713211,
      "pose_mae_dy": 0.065309077501297,
      "pose_rmse_dtheta": 0.3583648204803467,
      "pose_rmse_dx": 0.22935135662555695,
      "pose_rmse_dy": 0.13772056996822357,
      "pose_rmse_mean": 0.24181225895881653,
      "rmse_dtheta": 0.04469318687915802,
      "rmse_dx": 0.02342505007982254,
      "rmse_dy": 0.010138415731489658,
      "rmse_mean": 0.02608555182814598,
      "rotation_flip": 0.004989308770745993,
      "sparse_tokens": 24094.0,
      "step": 5941,
      "turn_loss": 0.2571672797203064,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.27606392863779966,
      "grad_norm": 0.6441464424133301,
      "learning_rate": 5.157318108509858e-06,
      "loss": 0.1306,
      "mae_dtheta": 0.026797378435730934,
      "mae_dx": 0.010721445083618164,
      "mae_dy": 0.004984409548342228,
      "pose_mae_dtheta": 0.17767609655857086,
      "pose_mae_dx": 0.0882762148976326,
      "pose_mae_dy": 0.04856577143073082,
      "pose_rmse_dtheta": 0.32431256771087646,
      "pose_rmse_dx": 0.21942517161369324,
      "pose_rmse_dy": 0.10866587609052658,
      "pose_rmse_mean": 0.21746788918972015,
      "rmse_dtheta": 0.04285931959748268,
      "rmse_dx": 0.023328255861997604,
      "rmse_dy": 0.009624693542718887,
      "rmse_mean": 0.02527075633406639,
      "rotation_flip": 0.013232514262199402,
      "sparse_tokens": 8491.0,
      "step": 5942,
      "turn_loss": 0.23735448718070984,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 39466.0,
      "epoch": 0.27611038840364244,
      "grad_norm": 0.714149534702301,
      "learning_rate": 5.1559965385280355e-06,
      "loss": 0.2361,
      "mae_dtheta": 0.032302454113960266,
      "mae_dx": 0.012836701236665249,
      "mae_dy": 0.005518415942788124,
      "pose_mae_dtheta": 0.25197556614875793,
      "pose_mae_dx": 0.10380776226520538,
      "pose_mae_dy": 0.05550387501716614,
      "pose_rmse_dtheta": 0.4627913534641266,
      "pose_rmse_dx": 0.24121993780136108,
      "pose_rmse_dy": 0.1425219178199768,
      "pose_rmse_mean": 0.28217774629592896,
      "rmse_dtheta": 0.0526382178068161,
      "rmse_dx": 0.02608564868569374,
      "rmse_dy": 0.013637472875416279,
      "rmse_mean": 0.030787114053964615,
      "rotation_flip": 0.010031348094344139,
      "sparse_tokens": 29866.0,
      "step": 5943,
      "turn_loss": 0.26009294390678406,
      "turns": 122.0,
      "turns_per_sample": 122.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.2761568481694852,
      "grad_norm": 0.5483182668685913,
      "learning_rate": 5.154674957637291e-06,
      "loss": 0.0759,
      "mae_dtheta": 0.03152083605527878,
      "mae_dx": 0.008730609901249409,
      "mae_dy": 0.003320682793855667,
      "pose_mae_dtheta": 0.25747424364089966,
      "pose_mae_dx": 0.07135120034217834,
      "pose_mae_dy": 0.031651996076107025,
      "pose_rmse_dtheta": 0.4670252799987793,
      "pose_rmse_dx": 0.1641848385334015,
      "pose_rmse_dy": 0.08487486094236374,
      "pose_rmse_mean": 0.23869499564170837,
      "rmse_dtheta": 0.05129263177514076,
      "rmse_dx": 0.018310798332095146,
      "rmse_dy": 0.008452370762825012,
      "rmse_mean": 0.026018600910902023,
      "rotation_flip": 0.00958466436713934,
      "sparse_tokens": 5629.0,
      "step": 5944,
      "turn_loss": 0.2241421639919281,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 27902.0,
      "epoch": 0.276203307935328,
      "grad_norm": 0.6569050550460815,
      "learning_rate": 5.153353365930045e-06,
      "loss": 0.1332,
      "mae_dtheta": 0.030134234577417374,
      "mae_dx": 0.012928847223520279,
      "mae_dy": 0.004356576595455408,
      "pose_mae_dtheta": 0.24793189764022827,
      "pose_mae_dx": 0.11335889995098114,
      "pose_mae_dy": 0.049447812139987946,
      "pose_rmse_dtheta": 0.4468357563018799,
      "pose_rmse_dx": 0.2453097701072693,
      "pose_rmse_dy": 0.1386791318655014,
      "pose_rmse_mean": 0.27694156765937805,
      "rmse_dtheta": 0.04762442782521248,
      "rmse_dx": 0.0258047953248024,
      "rmse_dy": 0.010442264378070831,
      "rmse_mean": 0.027957163751125336,
      "rotation_flip": 0.010265183635056019,
      "sparse_tokens": 22982.0,
      "step": 5945,
      "turn_loss": 0.24215920269489288,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 37313.0,
      "epoch": 0.27624976770117077,
      "grad_norm": 0.4726641774177551,
      "learning_rate": 5.152031763498715e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.030668314546346664,
      "mae_dx": 0.010843493975698948,
      "mae_dy": 0.002951043890789151,
      "pose_mae_dtheta": 0.23679494857788086,
      "pose_mae_dx": 0.08495160192251205,
      "pose_mae_dy": 0.031854934990406036,
      "pose_rmse_dtheta": 0.4138678312301636,
      "pose_rmse_dx": 0.19458070397377014,
      "pose_rmse_dy": 0.09092462062835693,
      "pose_rmse_mean": 0.23312437534332275,
      "rmse_dtheta": 0.04843492433428764,
      "rmse_dx": 0.02211986668407917,
      "rmse_dy": 0.0064821867272257805,
      "rmse_mean": 0.02567899227142334,
      "rotation_flip": 0.013126491568982601,
      "sparse_tokens": 29494.0,
      "step": 5946,
      "turn_loss": 0.2311762124300003,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.27629622746701354,
      "grad_norm": 0.49127086997032166,
      "learning_rate": 5.1507101504357225e-06,
      "loss": 0.096,
      "mae_dtheta": 0.008711003698408604,
      "mae_dx": 0.001612466061487794,
      "mae_dy": 0.0014623688766732812,
      "pose_mae_dtheta": 0.06525970250368118,
      "pose_mae_dx": 0.01958348974585533,
      "pose_mae_dy": 0.02095651812851429,
      "pose_rmse_dtheta": 0.18604405224323273,
      "pose_rmse_dx": 0.05196301266551018,
      "pose_rmse_dy": 0.06090327352285385,
      "pose_rmse_mean": 0.09963678568601608,
      "rmse_dtheta": 0.02269073761999607,
      "rmse_dx": 0.004955406300723553,
      "rmse_dy": 0.0034619818907231092,
      "rmse_mean": 0.010369375348091125,
      "rotation_flip": 0.0018966335337609053,
      "sparse_tokens": 32121.0,
      "step": 5947,
      "turn_loss": 0.05372592806816101,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.2763426872328563,
      "grad_norm": 0.5550622940063477,
      "learning_rate": 5.149388526833488e-06,
      "loss": 0.0638,
      "mae_dtheta": 0.010911510325968266,
      "mae_dx": 0.0017413754248991609,
      "mae_dy": 0.001151371980085969,
      "pose_mae_dtheta": 0.07544863969087601,
      "pose_mae_dx": 0.01713111810386181,
      "pose_mae_dy": 0.015181547962129116,
      "pose_rmse_dtheta": 0.2344346046447754,
      "pose_rmse_dx": 0.03945491462945938,
      "pose_rmse_dy": 0.04163491353392601,
      "pose_rmse_mean": 0.10517480969429016,
      "rmse_dtheta": 0.02970775216817856,
      "rmse_dx": 0.004916005302220583,
      "rmse_dy": 0.002693284535780549,
      "rmse_mean": 0.01243901439011097,
      "rotation_flip": 0.002533783670514822,
      "sparse_tokens": 32217.0,
      "step": 5948,
      "turn_loss": 0.06577819585800171,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.27638914699869915,
      "grad_norm": 0.5130982995033264,
      "learning_rate": 5.148066892784434e-06,
      "loss": 0.0916,
      "mae_dtheta": 0.010325065813958645,
      "mae_dx": 0.0011875664349645376,
      "mae_dy": 0.00020868534920737147,
      "pose_mae_dtheta": 0.0761810913681984,
      "pose_mae_dx": 0.009179284796118736,
      "pose_mae_dy": 0.0028208859730511904,
      "pose_rmse_dtheta": 0.3129636347293854,
      "pose_rmse_dx": 0.021899685263633728,
      "pose_rmse_dy": 0.005363457836210728,
      "pose_rmse_mean": 0.11340892314910889,
      "rmse_dtheta": 0.035796329379081726,
      "rmse_dx": 0.0034305716399103403,
      "rmse_dy": 0.0004589198506437242,
      "rmse_mean": 0.013228606432676315,
      "rotation_flip": 0.0026315790601074696,
      "sparse_tokens": 32185.0,
      "step": 5949,
      "turn_loss": 0.042008399963378906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.27643560676454193,
      "grad_norm": 0.7563157081604004,
      "learning_rate": 5.146745248380982e-06,
      "loss": 0.1928,
      "mae_dtheta": 0.04501684010028839,
      "mae_dx": 0.014792132191359997,
      "mae_dy": 0.006093574222177267,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7563158869743347,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.9725799560547,
      "model/head/act_norm_mean": 95.58578330592105,
      "model/head/act_norm_min": 69.37606048583984,
      "model/head/act_over_embed": 65.68744517603145,
      "model/head/grad_frac": 0.10462725907564163,
      "model/head/grad_norm": 0.07913126051425934,
      "model/head/grad_zero_frac": 0.0001649813202675432,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6937191611842105,
      "model/head/update_ratio": 0.00135216920170933,
      "model/head/weight_delta": 8.901554107666016,
      "model/head/weight_delta_rel": 0.15615962445735931,
      "model/head/weight_norm": 58.5217170715332,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42075562477111816,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42075562477111816,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42075562477111816,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2891472045189342,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10198651254177094,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07713402062654495,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0024930883664637804,
      "model/modality_embedder.encoders.pose/weight_delta": 2.89302134513855,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09452402591705322,
      "model/modality_embedder.encoders.pose/weight_norm": 30.939144134521484,
      "model/modality_embedder/grad_frac": 0.10198651254177094,
      "model/modality_embedder/grad_norm": 0.07713402062654495,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0024930883664637804,
      "model/modality_embedder/weight_delta": 2.89302134513855,
      "model/modality_embedder/weight_delta_rel": 0.09452402591705322,
      "model/modality_embedder/weight_norm": 30.939144134521484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.08927917480469,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.257154931599832,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.0718412399292,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.295325243762871,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1193452849984169,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.09026273339986801,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.003240149235352874,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.265298843383789,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08254885673522949,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.857585906982422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.00218963623047,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.03214089912281,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.71048641204834,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.827902856177602,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09831881523132324,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07436008006334305,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002512148581445217,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.8699607849121094,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09941768646240234,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.60019302368164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.06316375732422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.65890311716792,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.238961219787598,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.945829082406043,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09553142637014389,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07225193828344345,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0023641737643629313,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.094702959060669,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10391432791948318,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.56117820739746,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 73.98188018798828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.593934380221388,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.611669540405273,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.275600682424493,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08004482835531235,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06053917482495308,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020302031189203262,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.643235921859741,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09033326059579849,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.819271087646484,
      "model/normalizer/grad_frac": 0.3407198488712311,
      "model/normalizer/grad_norm": 0.2576918303966522,
      "model/normalizer/grad_zero_frac": 0.0001997137878788635,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0032840732019394636,
      "model/normalizer/weight_delta": 5.598764896392822,
      "model/normalizer/weight_delta_rel": 0.07210884988307953,
      "model/normalizer/weight_norm": 78.4671401977539,
      "pose_mae_dtheta": 0.39800068736076355,
      "pose_mae_dx": 0.10151761770248413,
      "pose_mae_dy": 0.07583700865507126,
      "pose_rmse_dtheta": 0.5923171043395996,
      "pose_rmse_dx": 0.21985076367855072,
      "pose_rmse_dy": 0.18879824876785278,
      "pose_rmse_mean": 0.33365535736083984,
      "rmse_dtheta": 0.060775063931941986,
      "rmse_dx": 0.027347823604941368,
      "rmse_dy": 0.014019742608070374,
      "rmse_mean": 0.03404754400253296,
      "rotation_flip": 0.013050571084022522,
      "sparse_tokens": 9849.0,
      "step": 5950,
      "turn_loss": 0.4387953281402588,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2764820665303847,
      "grad_norm": 0.4709932506084442,
      "learning_rate": 5.145423593715558e-06,
      "loss": 0.0882,
      "mae_dtheta": 0.007940440438687801,
      "mae_dx": 0.0011899981182068586,
      "mae_dy": 0.0016194670461118221,
      "pose_mae_dtheta": 0.054165031760931015,
      "pose_mae_dx": 0.016196271404623985,
      "pose_mae_dy": 0.020674778148531914,
      "pose_rmse_dtheta": 0.15925246477127075,
      "pose_rmse_dx": 0.05143137648701668,
      "pose_rmse_dy": 0.06306137889623642,
      "pose_rmse_mean": 0.09124840795993805,
      "rmse_dtheta": 0.020904093980789185,
      "rmse_dx": 0.003921201918274164,
      "rmse_dy": 0.004244391806423664,
      "rmse_mean": 0.009689896367490292,
      "rotation_flip": 0.006730769295245409,
      "sparse_tokens": 32105.0,
      "step": 5951,
      "turn_loss": 0.06779360771179199,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.2765285262962275,
      "grad_norm": 0.5456551313400269,
      "learning_rate": 5.144101928880581e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.0447227768599987,
      "mae_dx": 0.004611282143741846,
      "mae_dy": 0.004439349751919508,
      "pose_mae_dtheta": 0.364501029253006,
      "pose_mae_dx": 0.026148449629545212,
      "pose_mae_dy": 0.03969249501824379,
      "pose_rmse_dtheta": 0.6099526286125183,
      "pose_rmse_dx": 0.05955448001623154,
      "pose_rmse_dy": 0.09228459000587463,
      "pose_rmse_mean": 0.25393056869506836,
      "rmse_dtheta": 0.06853437423706055,
      "rmse_dx": 0.01091577485203743,
      "rmse_dy": 0.010880958288908005,
      "rmse_mean": 0.030110370367765427,
      "rotation_flip": 0.008333333767950535,
      "sparse_tokens": 3958.0,
      "step": 5952,
      "turn_loss": 0.35600534081459045,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.27657498606207026,
      "grad_norm": 0.7476276159286499,
      "learning_rate": 5.142780253968481e-06,
      "loss": 0.1428,
      "mae_dtheta": 0.015597842633724213,
      "mae_dx": 0.002814755542203784,
      "mae_dy": 0.0030050131026655436,
      "pose_mae_dtheta": 0.10639684647321701,
      "pose_mae_dx": 0.03248293325304985,
      "pose_mae_dy": 0.038600124418735504,
      "pose_rmse_dtheta": 0.25568118691444397,
      "pose_rmse_dx": 0.08400056511163712,
      "pose_rmse_dy": 0.08977112919092178,
      "pose_rmse_mean": 0.1431509554386139,
      "rmse_dtheta": 0.030261101201176643,
      "rmse_dx": 0.009119557216763496,
      "rmse_dy": 0.006420457735657692,
      "rmse_mean": 0.015267039649188519,
      "rotation_flip": 0.005529562011361122,
      "sparse_tokens": 32025.0,
      "step": 5953,
      "turn_loss": 0.1163492500782013,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24665.0,
      "epoch": 0.27662144582791304,
      "grad_norm": 0.7566079497337341,
      "learning_rate": 5.141458569071681e-06,
      "loss": 0.2602,
      "mae_dtheta": 0.04140602797269821,
      "mae_dx": 0.01106569916009903,
      "mae_dy": 0.004928134381771088,
      "pose_mae_dtheta": 0.3384294807910919,
      "pose_mae_dx": 0.08487845212221146,
      "pose_mae_dy": 0.053086232393980026,
      "pose_rmse_dtheta": 0.5840789079666138,
      "pose_rmse_dx": 0.1989241987466812,
      "pose_rmse_dy": 0.13055600225925446,
      "pose_rmse_mean": 0.3045197129249573,
      "rmse_dtheta": 0.06185072660446167,
      "rmse_dx": 0.023345578461885452,
      "rmse_dy": 0.010643444955348969,
      "rmse_mean": 0.031946584582328796,
      "rotation_flip": 0.010906040668487549,
      "sparse_tokens": 20685.0,
      "step": 5954,
      "turn_loss": 0.2991417944431305,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.2766679055937558,
      "grad_norm": 0.5619727373123169,
      "learning_rate": 5.140136874282607e-06,
      "loss": 0.1515,
      "mae_dtheta": 0.038390152156353,
      "mae_dx": 0.01424951571971178,
      "mae_dy": 0.006465819198638201,
      "pose_mae_dtheta": 0.32964643836021423,
      "pose_mae_dx": 0.12271686643362045,
      "pose_mae_dy": 0.08269264549016953,
      "pose_rmse_dtheta": 0.5334996581077576,
      "pose_rmse_dx": 0.26884838938713074,
      "pose_rmse_dy": 0.18332059681415558,
      "pose_rmse_mean": 0.32855620980262756,
      "rmse_dtheta": 0.053922463208436966,
      "rmse_dx": 0.02779587358236313,
      "rmse_dy": 0.012735990807414055,
      "rmse_mean": 0.031484778970479965,
      "rotation_flip": 0.013473053462803364,
      "sparse_tokens": 20708.0,
      "step": 5955,
      "turn_loss": 0.3304288983345032,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2767143653595986,
      "grad_norm": 0.5777056217193604,
      "learning_rate": 5.138815169693687e-06,
      "loss": 0.108,
      "mae_dtheta": 0.010271502658724785,
      "mae_dx": 0.002045794390141964,
      "mae_dy": 0.0032907123677432537,
      "pose_mae_dtheta": 0.06525471806526184,
      "pose_mae_dx": 0.0285893976688385,
      "pose_mae_dy": 0.031153537333011627,
      "pose_rmse_dtheta": 0.12021712213754654,
      "pose_rmse_dx": 0.07613413780927658,
      "pose_rmse_dy": 0.06685234606266022,
      "pose_rmse_mean": 0.08773454278707504,
      "rmse_dtheta": 0.018807807937264442,
      "rmse_dx": 0.005847256164997816,
      "rmse_dy": 0.007031199987977743,
      "rmse_mean": 0.010562088340520859,
      "rotation_flip": 0.006132756359875202,
      "sparse_tokens": 32057.0,
      "step": 5956,
      "turn_loss": 0.09515876322984695,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.27676082512544137,
      "grad_norm": 0.9053596258163452,
      "learning_rate": 5.1374934553973466e-06,
      "loss": 0.1719,
      "mae_dtheta": 0.0360967218875885,
      "mae_dx": 0.009581738151609898,
      "mae_dy": 0.004042259883135557,
      "pose_mae_dtheta": 0.2755725681781769,
      "pose_mae_dx": 0.07626473903656006,
      "pose_mae_dy": 0.043733615428209305,
      "pose_rmse_dtheta": 0.5228231549263,
      "pose_rmse_dx": 0.17371241748332977,
      "pose_rmse_dy": 0.12370456010103226,
      "pose_rmse_mean": 0.27341338992118835,
      "rmse_dtheta": 0.056102316826581955,
      "rmse_dx": 0.021466167643666267,
      "rmse_dy": 0.009509265422821045,
      "rmse_mean": 0.029025917872786522,
      "rotation_flip": 0.020533880218863487,
      "sparse_tokens": 14783.0,
      "step": 5957,
      "turn_loss": 0.31093090772628784,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.27680728489128414,
      "grad_norm": 0.4587971866130829,
      "learning_rate": 5.136171731486016e-06,
      "loss": 0.118,
      "mae_dtheta": 0.010827695019543171,
      "mae_dx": 0.0027067202609032393,
      "mae_dy": 0.0025751511566340923,
      "pose_mae_dtheta": 0.07489719241857529,
      "pose_mae_dx": 0.026687266305088997,
      "pose_mae_dy": 0.028214704245328903,
      "pose_rmse_dtheta": 0.16232098639011383,
      "pose_rmse_dx": 0.07167433947324753,
      "pose_rmse_dy": 0.06161632761359215,
      "pose_rmse_mean": 0.09853722155094147,
      "rmse_dtheta": 0.0219810139387846,
      "rmse_dx": 0.008691522292792797,
      "rmse_dy": 0.005637886002659798,
      "rmse_mean": 0.012103473767638206,
      "rotation_flip": 0.00667189946398139,
      "sparse_tokens": 32137.0,
      "step": 5958,
      "turn_loss": 0.10128165781497955,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.2768537446571269,
      "grad_norm": 0.3957284986972809,
      "learning_rate": 5.134849998052123e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.034141309559345245,
      "mae_dx": 0.011867223307490349,
      "mae_dy": 0.005461699794977903,
      "pose_mae_dtheta": 0.2676372826099396,
      "pose_mae_dx": 0.10221811383962631,
      "pose_mae_dy": 0.06666019558906555,
      "pose_rmse_dtheta": 0.44483402371406555,
      "pose_rmse_dx": 0.22420437633991241,
      "pose_rmse_dy": 0.16655555367469788,
      "pose_rmse_mean": 0.2785313129425049,
      "rmse_dtheta": 0.050537195056676865,
      "rmse_dx": 0.024198701605200768,
      "rmse_dy": 0.011424700729548931,
      "rmse_mean": 0.028720198199152946,
      "rotation_flip": 0.016318537294864655,
      "sparse_tokens": 27318.0,
      "step": 5959,
      "turn_loss": 0.2823963463306427,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2769002044229697,
      "grad_norm": 0.5249302983283997,
      "learning_rate": 5.133528255188096e-06,
      "loss": 0.1083,
      "mae_dtheta": 0.009198363870382309,
      "mae_dx": 0.0020234694238752127,
      "mae_dy": 0.002632048213854432,
      "pose_mae_dtheta": 0.07039450854063034,
      "pose_mae_dx": 0.027791256085038185,
      "pose_mae_dy": 0.030943982303142548,
      "pose_rmse_dtheta": 0.21442976593971252,
      "pose_rmse_dx": 0.08192382752895355,
      "pose_rmse_dy": 0.13160446286201477,
      "pose_rmse_mean": 0.142652690410614,
      "rmse_dtheta": 0.025258580222725868,
      "rmse_dx": 0.0054446859285235405,
      "rmse_dy": 0.008534839376807213,
      "rmse_mean": 0.013079367578029633,
      "rotation_flip": 0.009799118153750896,
      "sparse_tokens": 32137.0,
      "step": 5960,
      "turn_loss": 0.08047821372747421,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14945.0,
      "epoch": 0.2769466641888125,
      "grad_norm": 0.48244738578796387,
      "learning_rate": 5.132206502986368e-06,
      "loss": 0.1268,
      "mae_dtheta": 0.02712194435298443,
      "mae_dx": 0.008158239535987377,
      "mae_dy": 0.005968704354017973,
      "pose_mae_dtheta": 0.2018015831708908,
      "pose_mae_dx": 0.05781253054738045,
      "pose_mae_dy": 0.05197335407137871,
      "pose_rmse_dtheta": 0.35419419407844543,
      "pose_rmse_dx": 0.14983201026916504,
      "pose_rmse_dy": 0.10477661341428757,
      "pose_rmse_mean": 0.20293426513671875,
      "rmse_dtheta": 0.04286627843976021,
      "rmse_dx": 0.018713245168328285,
      "rmse_dy": 0.01118173822760582,
      "rmse_mean": 0.024253755807876587,
      "rotation_flip": 0.007936508394777775,
      "sparse_tokens": 12411.0,
      "step": 5961,
      "turn_loss": 0.3067636489868164,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.27699312395465525,
      "grad_norm": 0.45016971230506897,
      "learning_rate": 5.130884741539367e-06,
      "loss": 0.1171,
      "mae_dtheta": 0.037879109382629395,
      "mae_dx": 0.011090981774032116,
      "mae_dy": 0.0068356432020664215,
      "pose_mae_dtheta": 0.3107001483440399,
      "pose_mae_dx": 0.10101166367530823,
      "pose_mae_dy": 0.1155821904540062,
      "pose_rmse_dtheta": 0.5305612683296204,
      "pose_rmse_dx": 0.21034973859786987,
      "pose_rmse_dy": 0.21384911239147186,
      "pose_rmse_mean": 0.31825339794158936,
      "rmse_dtheta": 0.05389456823468208,
      "rmse_dx": 0.024202143773436546,
      "rmse_dy": 0.011189883574843407,
      "rmse_mean": 0.02976219914853573,
      "rotation_flip": 0.00460122711956501,
      "sparse_tokens": 10485.0,
      "step": 5962,
      "turn_loss": 0.30829891562461853,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 18450.0,
      "epoch": 0.27703958372049803,
      "grad_norm": 0.4920058846473694,
      "learning_rate": 5.129562970939526e-06,
      "loss": 0.1636,
      "mae_dtheta": 0.04138230159878731,
      "mae_dx": 0.008217202499508858,
      "mae_dy": 0.005097344983369112,
      "pose_mae_dtheta": 0.35236304998397827,
      "pose_mae_dx": 0.061778850853443146,
      "pose_mae_dy": 0.061054881662130356,
      "pose_rmse_dtheta": 0.633515477180481,
      "pose_rmse_dx": 0.13272874057292938,
      "pose_rmse_dy": 0.15208259224891663,
      "pose_rmse_mean": 0.3061089515686035,
      "rmse_dtheta": 0.06090366095304489,
      "rmse_dx": 0.017201730981469154,
      "rmse_dy": 0.011815051548182964,
      "rmse_mean": 0.029973480850458145,
      "rotation_flip": 0.00647948170080781,
      "sparse_tokens": 15538.0,
      "step": 5963,
      "turn_loss": 0.28516557812690735,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 22072.0,
      "epoch": 0.2770860434863408,
      "grad_norm": 0.46794259548187256,
      "learning_rate": 5.128241191279276e-06,
      "loss": 0.1463,
      "mae_dtheta": 0.031573474407196045,
      "mae_dx": 0.010193911381065845,
      "mae_dy": 0.004770869389176369,
      "pose_mae_dtheta": 0.2435164600610733,
      "pose_mae_dx": 0.09250125288963318,
      "pose_mae_dy": 0.05450877547264099,
      "pose_rmse_dtheta": 0.45031851530075073,
      "pose_rmse_dx": 0.2245068997144699,
      "pose_rmse_dy": 0.12604771554470062,
      "pose_rmse_mean": 0.26695773005485535,
      "rmse_dtheta": 0.05087883397936821,
      "rmse_dx": 0.02291165478527546,
      "rmse_dy": 0.010139797814190388,
      "rmse_mean": 0.027976764366030693,
      "rotation_flip": 0.00764818349853158,
      "sparse_tokens": 18703.0,
      "step": 5964,
      "turn_loss": 0.2690463960170746,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.2771325032521836,
      "grad_norm": 0.9453169107437134,
      "learning_rate": 5.126919402651053e-06,
      "loss": 0.1988,
      "mae_dtheta": 0.038075048476457596,
      "mae_dx": 0.008671521209180355,
      "mae_dy": 0.008960483595728874,
      "pose_mae_dtheta": 0.3017520308494568,
      "pose_mae_dx": 0.055402711033821106,
      "pose_mae_dy": 0.06050968915224075,
      "pose_rmse_dtheta": 0.5523769855499268,
      "pose_rmse_dx": 0.1438736468553543,
      "pose_rmse_dy": 0.17657814919948578,
      "pose_rmse_mean": 0.2909429371356964,
      "rmse_dtheta": 0.060351405292749405,
      "rmse_dx": 0.018449338153004646,
      "rmse_dy": 0.01975209452211857,
      "rmse_mean": 0.032850947231054306,
      "rotation_flip": 0.01315789483487606,
      "sparse_tokens": 8662.0,
      "step": 5965,
      "turn_loss": 0.31799888610839844,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2771789630180264,
      "grad_norm": 0.48847413063049316,
      "learning_rate": 5.1255976051472865e-06,
      "loss": 0.1476,
      "mae_dtheta": 0.01200733333826065,
      "mae_dx": 0.0018541717436164618,
      "mae_dy": 0.002281977329403162,
      "pose_mae_dtheta": 0.08504103124141693,
      "pose_mae_dx": 0.0252052154392004,
      "pose_mae_dy": 0.031729139387607574,
      "pose_rmse_dtheta": 0.2140369713306427,
      "pose_rmse_dx": 0.06435409933328629,
      "pose_rmse_dy": 0.06987986713647842,
      "pose_rmse_mean": 0.1160903126001358,
      "rmse_dtheta": 0.024901892989873886,
      "rmse_dx": 0.005918681155890226,
      "rmse_dy": 0.004447136074304581,
      "rmse_mean": 0.01175590418279171,
      "rotation_flip": 0.0061185467056930065,
      "sparse_tokens": 32089.0,
      "step": 5966,
      "turn_loss": 0.0794249027967453,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2772254227838692,
      "grad_norm": 0.5185036659240723,
      "learning_rate": 5.124275798860413e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.014832569286227226,
      "mae_dx": 0.0027033877559006214,
      "mae_dy": 0.0038377181626856327,
      "pose_mae_dtheta": 0.11043776571750641,
      "pose_mae_dx": 0.03034338168799877,
      "pose_mae_dy": 0.04076860100030899,
      "pose_rmse_dtheta": 0.27125057578086853,
      "pose_rmse_dx": 0.07992852479219437,
      "pose_rmse_dy": 0.09290511906147003,
      "pose_rmse_mean": 0.14802807569503784,
      "rmse_dtheta": 0.030504342168569565,
      "rmse_dx": 0.009402128867805004,
      "rmse_dy": 0.009108133614063263,
      "rmse_mean": 0.016338203102350235,
      "rotation_flip": 0.008443465456366539,
      "sparse_tokens": 32105.0,
      "step": 5967,
      "turn_loss": 0.13021411001682281,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.27727188254971197,
      "grad_norm": 0.5885867476463318,
      "learning_rate": 5.122953983882865e-06,
      "loss": 0.1569,
      "mae_dtheta": 0.019378991797566414,
      "mae_dx": 0.0024513020180165768,
      "mae_dy": 0.0011929139727726579,
      "pose_mae_dtheta": 0.11587701737880707,
      "pose_mae_dx": 0.01652422919869423,
      "pose_mae_dy": 0.01628439873456955,
      "pose_rmse_dtheta": 0.2325826734304428,
      "pose_rmse_dx": 0.04970237612724304,
      "pose_rmse_dy": 0.04857145622372627,
      "pose_rmse_mean": 0.11028550565242767,
      "rmse_dtheta": 0.040393322706222534,
      "rmse_dx": 0.007098341826349497,
      "rmse_dy": 0.0030031318310648203,
      "rmse_mean": 0.016831599175930023,
      "rotation_flip": 0.014218009077012539,
      "sparse_tokens": 3975.0,
      "step": 5968,
      "turn_loss": 0.09857454150915146,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.27731834231555474,
      "grad_norm": 0.815744936466217,
      "learning_rate": 5.121632160307078e-06,
      "loss": 0.1877,
      "mae_dtheta": 0.041186559945344925,
      "mae_dx": 0.009094610810279846,
      "mae_dy": 0.004011895973235369,
      "pose_mae_dtheta": 0.2872530519962311,
      "pose_mae_dx": 0.06267146021127701,
      "pose_mae_dy": 0.041714079678058624,
      "pose_rmse_dtheta": 0.5458077788352966,
      "pose_rmse_dx": 0.174767404794693,
      "pose_rmse_dy": 0.09480997920036316,
      "pose_rmse_mean": 0.2717950940132141,
      "rmse_dtheta": 0.0627659410238266,
      "rmse_dx": 0.021647769957780838,
      "rmse_dy": 0.008221013471484184,
      "rmse_mean": 0.03087824210524559,
      "rotation_flip": 0.014051522128283978,
      "sparse_tokens": 12342.0,
      "step": 5969,
      "turn_loss": 0.2990832030773163,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2773648020813975,
      "grad_norm": 0.4593592584133148,
      "learning_rate": 5.120310328225492e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.010536681860685349,
      "mae_dx": 0.0023006366100162268,
      "mae_dy": 0.00304537545889616,
      "pose_mae_dtheta": 0.0732518658041954,
      "pose_mae_dx": 0.028819942846894264,
      "pose_mae_dy": 0.03286068141460419,
      "pose_rmse_dtheta": 0.1520567089319229,
      "pose_rmse_dx": 0.07857433706521988,
      "pose_rmse_dy": 0.07463075965642929,
      "pose_rmse_mean": 0.10175394266843796,
      "rmse_dtheta": 0.020979734137654305,
      "rmse_dx": 0.006892438046634197,
      "rmse_dy": 0.007012327667325735,
      "rmse_mean": 0.0116281658411026,
      "rotation_flip": 0.005807200912386179,
      "sparse_tokens": 32073.0,
      "step": 5970,
      "turn_loss": 0.09465552866458893,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2774112618472403,
      "grad_norm": 0.7461062669754028,
      "learning_rate": 5.118988487730537e-06,
      "loss": 0.2063,
      "mae_dtheta": 0.012025764212012291,
      "mae_dx": 0.001294617890380323,
      "mae_dy": 0.002991608576849103,
      "pose_mae_dtheta": 0.07439358532428741,
      "pose_mae_dx": 0.021032169461250305,
      "pose_mae_dy": 0.03765992447733879,
      "pose_rmse_dtheta": 0.1787625253200531,
      "pose_rmse_dx": 0.054147202521562576,
      "pose_rmse_dy": 0.08220172673463821,
      "pose_rmse_mean": 0.1050371527671814,
      "rmse_dtheta": 0.02416338212788105,
      "rmse_dx": 0.0036224210634827614,
      "rmse_dy": 0.00674501433968544,
      "rmse_mean": 0.011510273441672325,
      "rotation_flip": 0.0040064104832708836,
      "sparse_tokens": 32073.0,
      "step": 5971,
      "turn_loss": 0.1053629219532013,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2774577216130831,
      "grad_norm": 0.4140718877315521,
      "learning_rate": 5.1176666389146554e-06,
      "loss": 0.0774,
      "mae_dtheta": 0.00749892508611083,
      "mae_dx": 0.0014452124014496803,
      "mae_dy": 0.0018823858117684722,
      "pose_mae_dtheta": 0.046805284917354584,
      "pose_mae_dx": 0.02014794573187828,
      "pose_mae_dy": 0.023501304909586906,
      "pose_rmse_dtheta": 0.09890086948871613,
      "pose_rmse_dx": 0.06077342480421066,
      "pose_rmse_dy": 0.05393626540899277,
      "pose_rmse_mean": 0.07120352238416672,
      "rmse_dtheta": 0.016075335443019867,
      "rmse_dx": 0.004941218998283148,
      "rmse_dy": 0.004416512791067362,
      "rmse_mean": 0.008477689698338509,
      "rotation_flip": 0.0036314118187874556,
      "sparse_tokens": 32057.0,
      "step": 5972,
      "turn_loss": 0.06895232945680618,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.27750418137892585,
      "grad_norm": 0.40726664662361145,
      "learning_rate": 5.116344781870282e-06,
      "loss": 0.0935,
      "mae_dtheta": 0.007311205379664898,
      "mae_dx": 0.001501951483078301,
      "mae_dy": 0.000927568762563169,
      "pose_mae_dtheta": 0.04943351820111275,
      "pose_mae_dx": 0.014410399831831455,
      "pose_mae_dy": 0.013001006096601486,
      "pose_rmse_dtheta": 0.1513531506061554,
      "pose_rmse_dx": 0.03184061869978905,
      "pose_rmse_dy": 0.039610568434000015,
      "pose_rmse_mean": 0.07426811754703522,
      "rmse_dtheta": 0.02149420976638794,
      "rmse_dx": 0.004016214516013861,
      "rmse_dy": 0.0020251781679689884,
      "rmse_mean": 0.009178534150123596,
      "rotation_flip": 0.0025641026441007853,
      "sparse_tokens": 32233.0,
      "step": 5973,
      "turn_loss": 0.06475790590047836,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.27755064114476863,
      "grad_norm": 0.6361306309700012,
      "learning_rate": 5.115022916689856e-06,
      "loss": 0.146,
      "mae_dtheta": 0.041881561279296875,
      "mae_dx": 0.007333863992244005,
      "mae_dy": 0.005881181918084621,
      "pose_mae_dtheta": 0.33587542176246643,
      "pose_mae_dx": 0.06807422637939453,
      "pose_mae_dy": 0.06888753920793533,
      "pose_rmse_dtheta": 0.6128912568092346,
      "pose_rmse_dx": 0.17716938257217407,
      "pose_rmse_dy": 0.1586088240146637,
      "pose_rmse_mean": 0.31622314453125,
      "rmse_dtheta": 0.06319782882928848,
      "rmse_dx": 0.01799815148115158,
      "rmse_dy": 0.012327148579061031,
      "rmse_mean": 0.031174376606941223,
      "rotation_flip": 0.004043126478791237,
      "sparse_tokens": 13269.0,
      "step": 5974,
      "turn_loss": 0.34143730998039246,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 40438.0,
      "epoch": 0.2775971009106114,
      "grad_norm": 0.6442573070526123,
      "learning_rate": 5.113701043465815e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.034492313861846924,
      "mae_dx": 0.01286384928971529,
      "mae_dy": 0.00601571099832654,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6442570090293884,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.12791442871094,
      "model/head/act_norm_mean": 111.215140625,
      "model/head/act_norm_min": 67.4924087524414,
      "model/head/act_over_embed": 76.4280858500511,
      "model/head/grad_frac": 0.06943827122449875,
      "model/head/grad_norm": 0.044736091047525406,
      "model/head/grad_zero_frac": 0.0001935357868205756,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6918828125,
      "model/head/update_ratio": 0.000764391093980521,
      "model/head/weight_delta": 8.912960052490234,
      "model/head/weight_delta_rel": 0.1563597172498703,
      "model/head/weight_norm": 58.5251350402832,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42074987292289734,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42074987292289734,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42074987292289734,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28914325179498723,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0401841476559639,
      "model/modality_embedder.encoders.pose/grad_norm": 0.025888919830322266,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.000836747873108834,
      "model/modality_embedder.encoders.pose/weight_delta": 2.8983542919158936,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09469826519489288,
      "model/modality_embedder.encoders.pose/weight_norm": 30.93992805480957,
      "model/modality_embedder/grad_frac": 0.0401841476559639,
      "model/modality_embedder/grad_norm": 0.025888919830322266,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.000836747873108834,
      "model/modality_embedder/weight_delta": 2.8983542919158936,
      "model/modality_embedder/weight_delta_rel": 0.09469826519489288,
      "model/modality_embedder/weight_norm": 30.93992805480957,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.61018371582031,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.726555555555557,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.067557334899902,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.30511110929063,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05960872769355774,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03840333968400955,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013785024639219046,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.270599365234375,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08274201303720474,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.85873794555664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.86002349853516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.543583333333334,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.5512113571167,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.866580247314086,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06072524935007095,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03912266716361046,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.00132161530200392,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.8768904209136963,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09965772926807404,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.60215950012207,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.57540893554688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.184035714285713,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.511554718017578,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.993914481661722,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06321300566196442,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04072542116045952,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013325080508366227,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.1023082733154297,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10416970402002335,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.5629825592041,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.29267120361328,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.100210317460316,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.4503173828125,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.31072760847259,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07848160713911057,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05056232586503029,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016955988248810172,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.64925217628479,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0905388668179512,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.819746017456055,
      "model/normalizer/grad_frac": 0.30158352851867676,
      "model/normalizer/grad_norm": 0.19429729878902435,
      "model/normalizer/grad_zero_frac": 0.00018671466386877,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0024761073291301727,
      "model/normalizer/weight_delta": 5.612123012542725,
      "model/normalizer/weight_delta_rel": 0.0722808986902237,
      "model/normalizer/weight_norm": 78.4688491821289,
      "pose_mae_dtheta": 0.26600468158721924,
      "pose_mae_dx": 0.10284091532230377,
      "pose_mae_dy": 0.061750419437885284,
      "pose_rmse_dtheta": 0.4914846420288086,
      "pose_rmse_dx": 0.23685353994369507,
      "pose_rmse_dy": 0.16016589105129242,
      "pose_rmse_mean": 0.2961680293083191,
      "rmse_dtheta": 0.05405774712562561,
      "rmse_dx": 0.025554882362484932,
      "rmse_dy": 0.014758155681192875,
      "rmse_mean": 0.031456928700208664,
      "rotation_flip": 0.012696493417024612,
      "sparse_tokens": 29938.0,
      "step": 5975,
      "turn_loss": 0.26689252257347107,
      "turns": 125.0,
      "turns_per_sample": 125.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.2776435606764542,
      "grad_norm": 0.4971238970756531,
      "learning_rate": 5.112379162290599e-06,
      "loss": 0.1318,
      "mae_dtheta": 0.044512297958135605,
      "mae_dx": 0.013917053118348122,
      "mae_dy": 0.002696429379284382,
      "pose_mae_dtheta": 0.36591464281082153,
      "pose_mae_dx": 0.10358189791440964,
      "pose_mae_dy": 0.03814171999692917,
      "pose_rmse_dtheta": 0.6428720355033875,
      "pose_rmse_dx": 0.25427013635635376,
      "pose_rmse_dy": 0.08734641969203949,
      "pose_rmse_mean": 0.32816287875175476,
      "rmse_dtheta": 0.0666886568069458,
      "rmse_dx": 0.028103608638048172,
      "rmse_dy": 0.005520148668438196,
      "rmse_mean": 0.033437471836805344,
      "rotation_flip": 0.016771487891674042,
      "sparse_tokens": 8151.0,
      "step": 5976,
      "turn_loss": 0.2345055639743805,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.27769002044229696,
      "grad_norm": 0.48791128396987915,
      "learning_rate": 5.111057273256648e-06,
      "loss": 0.126,
      "mae_dtheta": 0.01337936520576477,
      "mae_dx": 0.0032176184467971325,
      "mae_dy": 0.0033401716500520706,
      "pose_mae_dtheta": 0.08534450829029083,
      "pose_mae_dx": 0.03528566285967827,
      "pose_mae_dy": 0.034568049013614655,
      "pose_rmse_dtheta": 0.19109246134757996,
      "pose_rmse_dx": 0.09984772652387619,
      "pose_rmse_dy": 0.07222551852464676,
      "pose_rmse_mean": 0.1210552379488945,
      "rmse_dtheta": 0.026766346767544746,
      "rmse_dx": 0.010518885217607021,
      "rmse_dy": 0.007461098954081535,
      "rmse_mean": 0.01491544395685196,
      "rotation_flip": 0.0007062146905809641,
      "sparse_tokens": 32089.0,
      "step": 5977,
      "turn_loss": 0.1228112280368805,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.27773648020813974,
      "grad_norm": 0.4079027771949768,
      "learning_rate": 5.1097353764564025e-06,
      "loss": 0.0967,
      "mae_dtheta": 0.009354781359434128,
      "mae_dx": 0.0012812423519790173,
      "mae_dy": 0.0018511805683374405,
      "pose_mae_dtheta": 0.05876900255680084,
      "pose_mae_dx": 0.017464010044932365,
      "pose_mae_dy": 0.02246222272515297,
      "pose_rmse_dtheta": 0.15951091051101685,
      "pose_rmse_dx": 0.05162966251373291,
      "pose_rmse_dy": 0.05418120324611664,
      "pose_rmse_mean": 0.08844059705734253,
      "rmse_dtheta": 0.021489428356289864,
      "rmse_dx": 0.004183811601251364,
      "rmse_dy": 0.004083310253918171,
      "rmse_mean": 0.009918849915266037,
      "rotation_flip": 0.004574565216898918,
      "sparse_tokens": 32057.0,
      "step": 5978,
      "turn_loss": 0.07368095219135284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2777829399739825,
      "grad_norm": 0.44349417090415955,
      "learning_rate": 5.108413471982303e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.011122629046440125,
      "mae_dx": 0.001686928211711347,
      "mae_dy": 0.0018168650567531586,
      "pose_mae_dtheta": 0.07061618566513062,
      "pose_mae_dx": 0.01835695281624794,
      "pose_mae_dy": 0.020885352045297623,
      "pose_rmse_dtheta": 0.18771986663341522,
      "pose_rmse_dx": 0.052402690052986145,
      "pose_rmse_dy": 0.04627825319766998,
      "pose_rmse_mean": 0.09546693414449692,
      "rmse_dtheta": 0.025600925087928772,
      "rmse_dx": 0.005364124197512865,
      "rmse_dy": 0.004647407680749893,
      "rmse_mean": 0.01187081914395094,
      "rotation_flip": 0.00977060291916132,
      "sparse_tokens": 32089.0,
      "step": 5979,
      "turn_loss": 0.07703747600317001,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2778293997398253,
      "grad_norm": 0.3312133252620697,
      "learning_rate": 5.1070915599267914e-06,
      "loss": 0.0913,
      "mae_dtheta": 0.009758039377629757,
      "mae_dx": 0.0014039847301319242,
      "mae_dy": 0.0021239311899989843,
      "pose_mae_dtheta": 0.06383485347032547,
      "pose_mae_dx": 0.01877870410680771,
      "pose_mae_dy": 0.028804080560803413,
      "pose_rmse_dtheta": 0.13480928540229797,
      "pose_rmse_dx": 0.04760882630944252,
      "pose_rmse_dy": 0.0677373930811882,
      "pose_rmse_mean": 0.083385169506073,
      "rmse_dtheta": 0.01887400820851326,
      "rmse_dx": 0.0046593621373176575,
      "rmse_dy": 0.004270521458238363,
      "rmse_mean": 0.009267964400351048,
      "rotation_flip": 0.005662514362484217,
      "sparse_tokens": 32057.0,
      "step": 5980,
      "turn_loss": 0.07422097772359848,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.27787585950566807,
      "grad_norm": 0.4542198181152344,
      "learning_rate": 5.105769640382309e-06,
      "loss": 0.0848,
      "mae_dtheta": 0.008706127293407917,
      "mae_dx": 0.0019630147144198418,
      "mae_dy": 0.002029908588156104,
      "pose_mae_dtheta": 0.0565146766602993,
      "pose_mae_dx": 0.02460728958249092,
      "pose_mae_dy": 0.022716732695698738,
      "pose_rmse_dtheta": 0.13975247740745544,
      "pose_rmse_dx": 0.06837031245231628,
      "pose_rmse_dy": 0.06251407414674759,
      "pose_rmse_mean": 0.09021228551864624,
      "rmse_dtheta": 0.02025122195482254,
      "rmse_dx": 0.005926073994487524,
      "rmse_dy": 0.004921416752040386,
      "rmse_mean": 0.010366237722337246,
      "rotation_flip": 0.002334267133846879,
      "sparse_tokens": 32057.0,
      "step": 5981,
      "turn_loss": 0.07483218610286713,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.2779223192715109,
      "grad_norm": 0.7743323445320129,
      "learning_rate": 5.104447713441299e-06,
      "loss": 0.1417,
      "mae_dtheta": 0.03367983177304268,
      "mae_dx": 0.013024596497416496,
      "mae_dy": 0.0019658845849335194,
      "pose_mae_dtheta": 0.27808085083961487,
      "pose_mae_dx": 0.10720916837453842,
      "pose_mae_dy": 0.03968994691967964,
      "pose_rmse_dtheta": 0.43531545996665955,
      "pose_rmse_dx": 0.22950297594070435,
      "pose_rmse_dy": 0.12081494182348251,
      "pose_rmse_mean": 0.26187777519226074,
      "rmse_dtheta": 0.05167023092508316,
      "rmse_dx": 0.02489590458571911,
      "rmse_dy": 0.004178668837994337,
      "rmse_mean": 0.026914935559034348,
      "rotation_flip": 0.022792022675275803,
      "sparse_tokens": 6497.0,
      "step": 5982,
      "turn_loss": 0.21883289515972137,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.2779687790373537,
      "grad_norm": 0.6298919916152954,
      "learning_rate": 5.103125779196204e-06,
      "loss": 0.1058,
      "mae_dtheta": 0.02618088200688362,
      "mae_dx": 0.014156204648315907,
      "mae_dy": 0.0027258284389972687,
      "pose_mae_dtheta": 0.2060638964176178,
      "pose_mae_dx": 0.12412296235561371,
      "pose_mae_dy": 0.03869911655783653,
      "pose_rmse_dtheta": 0.42624884843826294,
      "pose_rmse_dx": 0.3081389367580414,
      "pose_rmse_dy": 0.10009738802909851,
      "pose_rmse_mean": 0.2781617343425751,
      "rmse_dtheta": 0.04405111074447632,
      "rmse_dx": 0.0297086201608181,
      "rmse_dy": 0.006033514626324177,
      "rmse_mean": 0.026597751304507256,
      "rotation_flip": 0.00918484479188919,
      "sparse_tokens": 17691.0,
      "step": 5983,
      "turn_loss": 0.17629103362560272,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.27801523880319645,
      "grad_norm": 0.6372911930084229,
      "learning_rate": 5.1018038377394685e-06,
      "loss": 0.2045,
      "mae_dtheta": 0.04888278990983963,
      "mae_dx": 0.009634613990783691,
      "mae_dy": 0.005045948550105095,
      "pose_mae_dtheta": 0.3980165421962738,
      "pose_mae_dx": 0.08132047206163406,
      "pose_mae_dy": 0.06448502838611603,
      "pose_rmse_dtheta": 0.6871353387832642,
      "pose_rmse_dx": 0.20995274186134338,
      "pose_rmse_dy": 0.230290487408638,
      "pose_rmse_mean": 0.37579286098480225,
      "rmse_dtheta": 0.07066111266613007,
      "rmse_dx": 0.020858604460954666,
      "rmse_dy": 0.013564267195761204,
      "rmse_mean": 0.03502799570560455,
      "rotation_flip": 0.012690355069935322,
      "sparse_tokens": 12896.0,
      "step": 5984,
      "turn_loss": 0.34665247797966003,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.27806169856903923,
      "grad_norm": 1.1691735982894897,
      "learning_rate": 5.100481889163535e-06,
      "loss": 0.2205,
      "mae_dtheta": 0.03137582167983055,
      "mae_dx": 0.006703754886984825,
      "mae_dy": 0.0035873265005648136,
      "pose_mae_dtheta": 0.2411767691373825,
      "pose_mae_dx": 0.04737184941768646,
      "pose_mae_dy": 0.031097300350666046,
      "pose_rmse_dtheta": 0.44104987382888794,
      "pose_rmse_dx": 0.12591226398944855,
      "pose_rmse_dy": 0.06594381481409073,
      "pose_rmse_mean": 0.21096865832805634,
      "rmse_dtheta": 0.04957290366292,
      "rmse_dx": 0.015624847263097763,
      "rmse_dy": 0.006812059320509434,
      "rmse_mean": 0.024003271013498306,
      "rotation_flip": 0.018675722181797028,
      "sparse_tokens": 9709.0,
      "step": 5985,
      "turn_loss": 0.2216041386127472,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.278108158334882,
      "grad_norm": 0.38477322459220886,
      "learning_rate": 5.099159933560851e-06,
      "loss": 0.0888,
      "mae_dtheta": 0.005432340782135725,
      "mae_dx": 0.0014223152538761497,
      "mae_dy": 0.0007523310487158597,
      "pose_mae_dtheta": 0.03985276445746422,
      "pose_mae_dx": 0.01418859139084816,
      "pose_mae_dy": 0.012058080174028873,
      "pose_rmse_dtheta": 0.12338949739933014,
      "pose_rmse_dx": 0.03223661705851555,
      "pose_rmse_dy": 0.040444087237119675,
      "pose_rmse_mean": 0.06535673886537552,
      "rmse_dtheta": 0.016343483701348305,
      "rmse_dx": 0.0038125915452837944,
      "rmse_dy": 0.0018652636790648103,
      "rmse_mean": 0.0073404461145401,
      "rotation_flip": 0.002376425778493285,
      "sparse_tokens": 32201.0,
      "step": 5986,
      "turn_loss": 0.04388147592544556,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2781546181007248,
      "grad_norm": 0.5774084329605103,
      "learning_rate": 5.097837971023859e-06,
      "loss": 0.1484,
      "mae_dtheta": 0.009738300926983356,
      "mae_dx": 0.0019849969539791346,
      "mae_dy": 0.0017654510447755456,
      "pose_mae_dtheta": 0.06575692445039749,
      "pose_mae_dx": 0.02363451197743416,
      "pose_mae_dy": 0.023216936737298965,
      "pose_rmse_dtheta": 0.17564000189304352,
      "pose_rmse_dx": 0.059718452394008636,
      "pose_rmse_dy": 0.05241665616631508,
      "pose_rmse_mean": 0.09592503309249878,
      "rmse_dtheta": 0.02121877484023571,
      "rmse_dx": 0.00626594852656126,
      "rmse_dy": 0.0038002561777830124,
      "rmse_mean": 0.01042832713574171,
      "rotation_flip": 0.003565768711268902,
      "sparse_tokens": 32137.0,
      "step": 5987,
      "turn_loss": 0.07404397428035736,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.27820107786656756,
      "grad_norm": 0.5234704613685608,
      "learning_rate": 5.096516001645003e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.007410021498799324,
      "mae_dx": 0.0017058493103832006,
      "mae_dy": 0.0011367127299308777,
      "pose_mae_dtheta": 0.05121348425745964,
      "pose_mae_dx": 0.01648053713142872,
      "pose_mae_dy": 0.014426489360630512,
      "pose_rmse_dtheta": 0.14444927871227264,
      "pose_rmse_dx": 0.041896753013134,
      "pose_rmse_dy": 0.03699701651930809,
      "pose_rmse_mean": 0.07444768399000168,
      "rmse_dtheta": 0.01905651018023491,
      "rmse_dx": 0.005320333410054445,
      "rmse_dy": 0.002362180734053254,
      "rmse_mean": 0.008913008496165276,
      "rotation_flip": 0.003348681377246976,
      "sparse_tokens": 32185.0,
      "step": 5988,
      "turn_loss": 0.05061814934015274,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.27824753763241034,
      "grad_norm": 0.5253580808639526,
      "learning_rate": 5.095194025516733e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.033625487238168716,
      "mae_dx": 0.015660766512155533,
      "mae_dy": 0.00423086155205965,
      "pose_mae_dtheta": 0.2369122952222824,
      "pose_mae_dx": 0.12953858077526093,
      "pose_mae_dy": 0.05001840740442276,
      "pose_rmse_dtheta": 0.392752468585968,
      "pose_rmse_dx": 0.27443423867225647,
      "pose_rmse_dy": 0.11307541280984879,
      "pose_rmse_mean": 0.26008740067481995,
      "rmse_dtheta": 0.04927073046565056,
      "rmse_dx": 0.02936330810189247,
      "rmse_dy": 0.007776251994073391,
      "rmse_mean": 0.028803430497646332,
      "rotation_flip": 0.008152173832058907,
      "sparse_tokens": 5740.0,
      "step": 5989,
      "turn_loss": 0.31557929515838623,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.2782939973982531,
      "grad_norm": 0.40389183163642883,
      "learning_rate": 5.093872042731495e-06,
      "loss": 0.1151,
      "mae_dtheta": 0.024687450379133224,
      "mae_dx": 0.00868245679885149,
      "mae_dy": 0.0037591455038636923,
      "pose_mae_dtheta": 0.18154484033584595,
      "pose_mae_dx": 0.05827478691935539,
      "pose_mae_dy": 0.050278883427381516,
      "pose_rmse_dtheta": 0.3457964062690735,
      "pose_rmse_dx": 0.14777255058288574,
      "pose_rmse_dy": 0.12327565997838974,
      "pose_rmse_mean": 0.2056148648262024,
      "rmse_dtheta": 0.040142472833395004,
      "rmse_dx": 0.02065391093492508,
      "rmse_dy": 0.007217335514724255,
      "rmse_mean": 0.02267124131321907,
      "rotation_flip": 0.009943181648850441,
      "sparse_tokens": 13650.0,
      "step": 5990,
      "turn_loss": 0.19788801670074463,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.2783404571640959,
      "grad_norm": 0.40352144837379456,
      "learning_rate": 5.092550053381733e-06,
      "loss": 0.0719,
      "mae_dtheta": 0.052320536226034164,
      "mae_dx": 0.016978465020656586,
      "mae_dy": 0.011414911597967148,
      "pose_mae_dtheta": 0.4780671000480652,
      "pose_mae_dx": 0.14312046766281128,
      "pose_mae_dy": 0.10698863118886948,
      "pose_rmse_dtheta": 0.7515039443969727,
      "pose_rmse_dx": 0.28741729259490967,
      "pose_rmse_dy": 0.2578202784061432,
      "pose_rmse_mean": 0.4322471618652344,
      "rmse_dtheta": 0.0709904134273529,
      "rmse_dx": 0.029289985075592995,
      "rmse_dy": 0.02582252025604248,
      "rmse_mean": 0.04203430935740471,
      "rotation_flip": 0.005747126415371895,
      "sparse_tokens": 5451.0,
      "step": 5991,
      "turn_loss": 0.34450897574424744,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.27838691692993867,
      "grad_norm": 0.8756110668182373,
      "learning_rate": 5.091228057559896e-06,
      "loss": 0.146,
      "mae_dtheta": 0.009681040421128273,
      "mae_dx": 0.002276819432154298,
      "mae_dy": 0.002274397062137723,
      "pose_mae_dtheta": 0.06921067833900452,
      "pose_mae_dx": 0.027807015925645828,
      "pose_mae_dy": 0.020032938569784164,
      "pose_rmse_dtheta": 0.21757327020168304,
      "pose_rmse_dx": 0.07164452970027924,
      "pose_rmse_dy": 0.05375634506344795,
      "pose_rmse_mean": 0.11432471871376038,
      "rmse_dtheta": 0.02561783604323864,
      "rmse_dx": 0.00577559182420373,
      "rmse_dy": 0.005426847375929356,
      "rmse_mean": 0.012273425236344337,
      "rotation_flip": 0.004955752287060022,
      "sparse_tokens": 32217.0,
      "step": 5992,
      "turn_loss": 0.0778455063700676,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.27843337669578144,
      "grad_norm": 0.4808080196380615,
      "learning_rate": 5.089906055358432e-06,
      "loss": 0.1326,
      "mae_dtheta": 0.03913826122879982,
      "mae_dx": 0.011873118579387665,
      "mae_dy": 0.004362367559224367,
      "pose_mae_dtheta": 0.34091371297836304,
      "pose_mae_dx": 0.08339302986860275,
      "pose_mae_dy": 0.05062670260667801,
      "pose_rmse_dtheta": 0.6229570508003235,
      "pose_rmse_dx": 0.21547292172908783,
      "pose_rmse_dy": 0.12137594074010849,
      "pose_rmse_mean": 0.31993532180786133,
      "rmse_dtheta": 0.06154730170965195,
      "rmse_dx": 0.026029881089925766,
      "rmse_dy": 0.008701213635504246,
      "rmse_mean": 0.03209279850125313,
      "rotation_flip": 0.012841091491281986,
      "sparse_tokens": 10311.0,
      "step": 5993,
      "turn_loss": 0.2928149700164795,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 26283.0,
      "epoch": 0.2784798364616242,
      "grad_norm": 0.9634458422660828,
      "learning_rate": 5.08858404686979e-06,
      "loss": 0.2553,
      "mae_dtheta": 0.023334914818406105,
      "mae_dx": 0.008244073949754238,
      "mae_dy": 0.0037151093129068613,
      "pose_mae_dtheta": 0.1649058312177658,
      "pose_mae_dx": 0.06687091290950775,
      "pose_mae_dy": 0.04962232708930969,
      "pose_rmse_dtheta": 0.32537615299224854,
      "pose_rmse_dx": 0.1779201626777649,
      "pose_rmse_dy": 0.1029139831662178,
      "pose_rmse_mean": 0.20207010209560394,
      "rmse_dtheta": 0.04031463712453842,
      "rmse_dx": 0.02039959281682968,
      "rmse_dy": 0.007056522183120251,
      "rmse_mean": 0.02259024977684021,
      "rotation_flip": 0.01671583019196987,
      "sparse_tokens": 21071.0,
      "step": 5994,
      "turn_loss": 0.2087809294462204,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.278526296227467,
      "grad_norm": 0.3145337700843811,
      "learning_rate": 5.087262032186418e-06,
      "loss": 0.0975,
      "mae_dtheta": 0.013728445395827293,
      "mae_dx": 0.0015625122468918562,
      "mae_dy": 0.003318330505862832,
      "pose_mae_dtheta": 0.09244825690984726,
      "pose_mae_dx": 0.028157806023955345,
      "pose_mae_dy": 0.03727518022060394,
      "pose_rmse_dtheta": 0.2289257049560547,
      "pose_rmse_dx": 0.06422311067581177,
      "pose_rmse_dy": 0.08444388210773468,
      "pose_rmse_mean": 0.12586423754692078,
      "rmse_dtheta": 0.026962624862790108,
      "rmse_dx": 0.003836203832179308,
      "rmse_dy": 0.006376961711794138,
      "rmse_mean": 0.01239193044602871,
      "rotation_flip": 0.005477784667164087,
      "sparse_tokens": 32105.0,
      "step": 5995,
      "turn_loss": 0.10710790753364563,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.2785727559933098,
      "grad_norm": 0.7098200917243958,
      "learning_rate": 5.0859400114007654e-06,
      "loss": 0.1758,
      "mae_dtheta": 0.05852575972676277,
      "mae_dx": 0.010718678124248981,
      "mae_dy": 0.017248239368200302,
      "pose_mae_dtheta": 0.5694320797920227,
      "pose_mae_dx": 0.10124220699071884,
      "pose_mae_dy": 0.18403618037700653,
      "pose_rmse_dtheta": 0.7754722237586975,
      "pose_rmse_dx": 0.18825334310531616,
      "pose_rmse_dy": 0.36311402916908264,
      "pose_rmse_mean": 0.4422798752784729,
      "rmse_dtheta": 0.0766768679022789,
      "rmse_dx": 0.01898377388715744,
      "rmse_dy": 0.03157852962613106,
      "rmse_mean": 0.04241305589675903,
      "rotation_flip": 0.007936508394777775,
      "sparse_tokens": 4578.0,
      "step": 5996,
      "turn_loss": 0.7539938688278198,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.27861921575915255,
      "grad_norm": 0.5836414694786072,
      "learning_rate": 5.084617984605281e-06,
      "loss": 0.1317,
      "mae_dtheta": 0.009591330774128437,
      "mae_dx": 0.0013893443392589688,
      "mae_dy": 0.0016676979139447212,
      "pose_mae_dtheta": 0.06797698140144348,
      "pose_mae_dx": 0.018705666065216064,
      "pose_mae_dy": 0.02170460857450962,
      "pose_rmse_dtheta": 0.21865439414978027,
      "pose_rmse_dx": 0.04868168383836746,
      "pose_rmse_dy": 0.053662706166505814,
      "pose_rmse_mean": 0.10699959844350815,
      "rmse_dtheta": 0.024326719343662262,
      "rmse_dx": 0.0047286697663366795,
      "rmse_dy": 0.0037765491288155317,
      "rmse_mean": 0.010943979024887085,
      "rotation_flip": 0.005836575757712126,
      "sparse_tokens": 32089.0,
      "step": 5997,
      "turn_loss": 0.0645490288734436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2786656755249953,
      "grad_norm": 0.5587245225906372,
      "learning_rate": 5.0832959518924165e-06,
      "loss": 0.0698,
      "mae_dtheta": 0.008163075894117355,
      "mae_dx": 0.0010924695525318384,
      "mae_dy": 0.0014871647581458092,
      "pose_mae_dtheta": 0.06011217460036278,
      "pose_mae_dx": 0.01678028702735901,
      "pose_mae_dy": 0.021394381299614906,
      "pose_rmse_dtheta": 0.1881239116191864,
      "pose_rmse_dx": 0.04417791962623596,
      "pose_rmse_dy": 0.055572740733623505,
      "pose_rmse_mean": 0.09595819562673569,
      "rmse_dtheta": 0.02172199822962284,
      "rmse_dx": 0.0036153532564640045,
      "rmse_dy": 0.0035246554762125015,
      "rmse_mean": 0.009620669297873974,
      "rotation_flip": 0.0009451796067878604,
      "sparse_tokens": 32073.0,
      "step": 5998,
      "turn_loss": 0.0523483045399189,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.27871213529083816,
      "grad_norm": 0.6047276258468628,
      "learning_rate": 5.081973913354621e-06,
      "loss": 0.1287,
      "mae_dtheta": 0.039795082062482834,
      "mae_dx": 0.014144865795969963,
      "mae_dy": 0.006279019173234701,
      "pose_mae_dtheta": 0.3226032257080078,
      "pose_mae_dx": 0.11382614821195602,
      "pose_mae_dy": 0.07497593760490417,
      "pose_rmse_dtheta": 0.5530254244804382,
      "pose_rmse_dx": 0.23657064139842987,
      "pose_rmse_dy": 0.17430739104747772,
      "pose_rmse_mean": 0.3213011622428894,
      "rmse_dtheta": 0.05824722722172737,
      "rmse_dx": 0.026876375079154968,
      "rmse_dy": 0.0126792648807168,
      "rmse_mean": 0.03260095417499542,
      "rotation_flip": 0.014272970147430897,
      "sparse_tokens": 19126.0,
      "step": 5999,
      "turn_loss": 0.30940085649490356,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.27875859505668094,
      "grad_norm": 0.6487158536911011,
      "learning_rate": 5.080651869084345e-06,
      "loss": 0.1598,
      "mae_dtheta": 0.030849048867821693,
      "mae_dx": 0.012120109051465988,
      "mae_dy": 0.004518040921539068,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.648715615272522,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.3693084716797,
      "model/head/act_norm_mean": 110.07973845108695,
      "model/head/act_norm_min": 78.27062225341797,
      "model/head/act_over_embed": 75.64782684633543,
      "model/head/grad_frac": 0.09752856940031052,
      "model/head/grad_norm": 0.06326830387115479,
      "model/head/grad_zero_frac": 0.0001754512923071161,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6921492866847826,
      "model/head/update_ratio": 0.0010809962404891849,
      "model/head/weight_delta": 8.926370620727539,
      "model/head/weight_delta_rel": 0.15659497678279877,
      "model/head/weight_norm": 58.527774810791016,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4207443296909332,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42069978916898687,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4206513464450836,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28910883377040847,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1623842865228653,
      "model/modality_embedder.encoders.pose/grad_norm": 0.10534121841192245,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5409325132978723,
      "model/modality_embedder.encoders.pose/update_ratio": 0.003404649905860424,
      "model/modality_embedder.encoders.pose/weight_delta": 2.897120952606201,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09465797245502472,
      "model/modality_embedder.encoders.pose/weight_norm": 30.940397262573242,
      "model/modality_embedder/grad_frac": 0.1623842865228653,
      "model/modality_embedder/grad_norm": 0.10534121841192245,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5409325132978723,
      "model/modality_embedder/update_ratio": 0.003404649905860424,
      "model/modality_embedder/weight_delta": 2.897120952606201,
      "model/modality_embedder/weight_delta_rel": 0.09465797245502472,
      "model/modality_embedder/weight_norm": 30.940397262573242,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.11083984375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.689635093167702,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.172429084777832,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.27973902188288,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06539203226566315,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04242083430290222,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015226684045046568,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.2756285667419434,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08292527496814728,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.859535217285156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.98942565917969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.525561809868876,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.780203819274902,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.85419568766915,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07578849047422409,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04916517809033394,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016607430297881365,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.8837196826934814,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.09989430010318756,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.604326248168945,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.81320190429688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.149461913388542,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.227906227111816,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.970155042000165,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08708686381578445,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05649460852146149,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001848331419751048,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.109398365020752,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10440777242183685,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.56519317626953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.55603790283203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.036611995341616,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.996800422668457,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.267022246095745,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09600312262773514,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06227872520685196,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002088357461616397,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.6558263301849365,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09076353907585144,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.821868896484375,
      "model/normalizer/grad_frac": 0.35439664125442505,
      "model/normalizer/grad_norm": 0.22990263998508453,
      "model/normalizer/grad_zero_frac": 0.00021507639030460268,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002929768757894635,
      "model/normalizer/weight_delta": 5.625188827514648,
      "model/normalizer/weight_delta_rel": 0.07244917750358582,
      "model/normalizer/weight_norm": 78.47126007080078,
      "pose_mae_dtheta": 0.24199602007865906,
      "pose_mae_dx": 0.08613669127225876,
      "pose_mae_dy": 0.060853179544210434,
      "pose_rmse_dtheta": 0.44363799691200256,
      "pose_rmse_dx": 0.20072776079177856,
      "pose_rmse_dy": 0.1658012568950653,
      "pose_rmse_mean": 0.27005571126937866,
      "rmse_dtheta": 0.04945715516805649,
      "rmse_dx": 0.025118080899119377,
      "rmse_dy": 0.010203612968325615,
      "rmse_mean": 0.02825961820781231,
      "rotation_flip": 0.022692888975143433,
      "sparse_tokens": 11649.0,
      "step": 6000,
      "turn_loss": 0.21457241475582123,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "epoch": 0.27875859505668094,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31295615434646606,
      "eval_objectnav_nopose_mae_dtheta": 0.040457651019096375,
      "eval_objectnav_nopose_mae_dx": 0.013406319543719292,
      "eval_objectnav_nopose_mae_dy": 0.0049744718708097935,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3253878057003021,
      "eval_objectnav_nopose_pose_mae_dx": 0.10701264441013336,
      "eval_objectnav_nopose_pose_mae_dy": 0.05541860684752464,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5500568151473999,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23496635258197784,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12930698692798615,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30477672815322876,
      "eval_objectnav_nopose_rmse_dtheta": 0.0584317222237587,
      "eval_objectnav_nopose_rmse_dx": 0.026361431926488876,
      "eval_objectnav_nopose_rmse_dy": 0.010148609057068825,
      "eval_objectnav_nopose_rmse_mean": 0.03164725378155708,
      "eval_objectnav_nopose_rotation_flip": 0.016648147255182266,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31295615434646606,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 6000
    },
    {
      "epoch": 0.27875859505668094,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28444138169288635,
      "eval_objectnav_pose_mae_dtheta": 0.036055102944374084,
      "eval_objectnav_pose_mae_dx": 0.011630372144281864,
      "eval_objectnav_pose_mae_dy": 0.004714859649538994,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2736243009567261,
      "eval_objectnav_pose_pose_mae_dx": 0.09149062633514404,
      "eval_objectnav_pose_pose_mae_dy": 0.0492606945335865,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.47850799560546875,
      "eval_objectnav_pose_pose_rmse_dx": 0.2084127962589264,
      "eval_objectnav_pose_pose_rmse_dy": 0.1184702217578888,
      "eval_objectnav_pose_pose_rmse_mean": 0.268463671207428,
      "eval_objectnav_pose_rmse_dtheta": 0.05381261929869652,
      "eval_objectnav_pose_rmse_dx": 0.023959405720233917,
      "eval_objectnav_pose_rmse_dy": 0.009851249866187572,
      "eval_objectnav_pose_rmse_mean": 0.029207756742835045,
      "eval_objectnav_pose_rotation_flip": 0.014365014620125294,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28444138169288635,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 6000
    },
    {
      "epoch": 0.27875859505668094,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09440039098262787,
      "eval_pointnav_mae_dtheta": 0.010878311470150948,
      "eval_pointnav_mae_dx": 0.0025788245256990194,
      "eval_pointnav_mae_dy": 0.002529092598706484,
      "eval_pointnav_pose_mae_dtheta": 0.07532335817813873,
      "eval_pointnav_pose_mae_dx": 0.028703395277261734,
      "eval_pointnav_pose_mae_dy": 0.027017900720238686,
      "eval_pointnav_pose_rmse_dtheta": 0.2080942690372467,
      "eval_pointnav_pose_rmse_dx": 0.08654872328042984,
      "eval_pointnav_pose_rmse_dy": 0.07645902037620544,
      "eval_pointnav_pose_rmse_mean": 0.12370067089796066,
      "eval_pointnav_rmse_dtheta": 0.02615237422287464,
      "eval_pointnav_rmse_dx": 0.008052007295191288,
      "eval_pointnav_rmse_dy": 0.006713752169162035,
      "eval_pointnav_rmse_mean": 0.013639378361403942,
      "eval_pointnav_rotation_flip": 0.005800497718155384,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09440039098262787,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 6000
    },
    {
      "epoch": 0.27875859505668094,
      "eval_loss": 0.23059930900732675,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31295615434646606,
      "eval_objectnav_nopose_mae_dtheta": 0.040457651019096375,
      "eval_objectnav_nopose_mae_dx": 0.013406319543719292,
      "eval_objectnav_nopose_mae_dy": 0.0049744718708097935,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3253878057003021,
      "eval_objectnav_nopose_pose_mae_dx": 0.10701264441013336,
      "eval_objectnav_nopose_pose_mae_dy": 0.05541860684752464,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5500568151473999,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23496635258197784,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12930698692798615,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30477672815322876,
      "eval_objectnav_nopose_rmse_dtheta": 0.0584317222237587,
      "eval_objectnav_nopose_rmse_dx": 0.026361431926488876,
      "eval_objectnav_nopose_rmse_dy": 0.010148609057068825,
      "eval_objectnav_nopose_rmse_mean": 0.03164725378155708,
      "eval_objectnav_nopose_rotation_flip": 0.016648147255182266,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31295615434646606,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28444138169288635,
      "eval_objectnav_pose_mae_dtheta": 0.036055102944374084,
      "eval_objectnav_pose_mae_dx": 0.011630372144281864,
      "eval_objectnav_pose_mae_dy": 0.004714859649538994,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2736243009567261,
      "eval_objectnav_pose_pose_mae_dx": 0.09149062633514404,
      "eval_objectnav_pose_pose_mae_dy": 0.0492606945335865,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.47850799560546875,
      "eval_objectnav_pose_pose_rmse_dx": 0.2084127962589264,
      "eval_objectnav_pose_pose_rmse_dy": 0.1184702217578888,
      "eval_objectnav_pose_pose_rmse_mean": 0.268463671207428,
      "eval_objectnav_pose_rmse_dtheta": 0.05381261929869652,
      "eval_objectnav_pose_rmse_dx": 0.023959405720233917,
      "eval_objectnav_pose_rmse_dy": 0.009851249866187572,
      "eval_objectnav_pose_rmse_mean": 0.029207756742835045,
      "eval_objectnav_pose_rotation_flip": 0.014365014620125294,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28444138169288635,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09440039098262787,
      "eval_pointnav_mae_dtheta": 0.010878311470150948,
      "eval_pointnav_mae_dx": 0.0025788245256990194,
      "eval_pointnav_mae_dy": 0.002529092598706484,
      "eval_pointnav_pose_mae_dtheta": 0.07532335817813873,
      "eval_pointnav_pose_mae_dx": 0.028703395277261734,
      "eval_pointnav_pose_mae_dy": 0.027017900720238686,
      "eval_pointnav_pose_rmse_dtheta": 0.2080942690372467,
      "eval_pointnav_pose_rmse_dx": 0.08654872328042984,
      "eval_pointnav_pose_rmse_dy": 0.07645902037620544,
      "eval_pointnav_pose_rmse_mean": 0.12370067089796066,
      "eval_pointnav_rmse_dtheta": 0.02615237422287464,
      "eval_pointnav_rmse_dx": 0.008052007295191288,
      "eval_pointnav_rmse_dy": 0.006713752169162035,
      "eval_pointnav_rmse_mean": 0.013639378361403942,
      "eval_pointnav_rotation_flip": 0.005800497718155384,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09440039098262787,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 6000
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.2788050548225237,
      "grad_norm": 0.5564773082733154,
      "learning_rate": 5.07932981917404e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.039687253534793854,
      "mae_dx": 0.011830986477434635,
      "mae_dy": 0.0050000986084342,
      "pose_mae_dtheta": 0.3264745771884918,
      "pose_mae_dx": 0.09712394326925278,
      "pose_mae_dy": 0.0441431999206543,
      "pose_rmse_dtheta": 0.5339699387550354,
      "pose_rmse_dx": 0.21257081627845764,
      "pose_rmse_dy": 0.10655247420072556,
      "pose_rmse_mean": 0.2843644320964813,
      "rmse_dtheta": 0.05825677141547203,
      "rmse_dx": 0.022538088262081146,
      "rmse_dy": 0.012490250170230865,
      "rmse_mean": 0.03109503537416458,
      "rotation_flip": 0.016181230545043945,
      "sparse_tokens": 15217.0,
      "step": 6001,
      "turn_loss": 0.3162694275379181,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2788515145883665,
      "grad_norm": 0.5143918395042419,
      "learning_rate": 5.078007763716159e-06,
      "loss": 0.1063,
      "mae_dtheta": 0.006842445582151413,
      "mae_dx": 0.0026220660656690598,
      "mae_dy": 0.0011898096418008208,
      "pose_mae_dtheta": 0.04657004773616791,
      "pose_mae_dx": 0.025777654722332954,
      "pose_mae_dy": 0.016283467411994934,
      "pose_rmse_dtheta": 0.1595393419265747,
      "pose_rmse_dx": 0.08180709183216095,
      "pose_rmse_dy": 0.05404909327626228,
      "pose_rmse_mean": 0.09846517443656921,
      "rmse_dtheta": 0.02157670445740223,
      "rmse_dx": 0.00971873290836811,
      "rmse_dy": 0.003344174474477768,
      "rmse_mean": 0.011546537280082703,
      "rotation_flip": 0.003052503103390336,
      "sparse_tokens": 32121.0,
      "step": 6002,
      "turn_loss": 0.09560424834489822,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.27889797435420927,
      "grad_norm": 0.6924737691879272,
      "learning_rate": 5.076685702803153e-06,
      "loss": 0.1191,
      "mae_dtheta": 0.012252547778189182,
      "mae_dx": 0.0015352180926129222,
      "mae_dy": 0.002565354108810425,
      "pose_mae_dtheta": 0.08316964656114578,
      "pose_mae_dx": 0.02563328668475151,
      "pose_mae_dy": 0.03357772156596184,
      "pose_rmse_dtheta": 0.1959235966205597,
      "pose_rmse_dx": 0.06953265517950058,
      "pose_rmse_dy": 0.08704477548599243,
      "pose_rmse_mean": 0.11750034987926483,
      "rmse_dtheta": 0.02489863894879818,
      "rmse_dx": 0.004087383393198252,
      "rmse_dy": 0.005418004933744669,
      "rmse_mean": 0.011468010023236275,
      "rotation_flip": 0.008447729982435703,
      "sparse_tokens": 32089.0,
      "step": 6003,
      "turn_loss": 0.09020660817623138,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.27894443412005204,
      "grad_norm": 0.5384116172790527,
      "learning_rate": 5.075363636527476e-06,
      "loss": 0.1295,
      "mae_dtheta": 0.024314559996128082,
      "mae_dx": 0.003235252806916833,
      "mae_dy": 0.005490889772772789,
      "pose_mae_dtheta": 0.17604835331439972,
      "pose_mae_dx": 0.04599800333380699,
      "pose_mae_dy": 0.08399009704589844,
      "pose_rmse_dtheta": 0.3264384865760803,
      "pose_rmse_dx": 0.10138064622879028,
      "pose_rmse_dy": 0.16185222566127777,
      "pose_rmse_mean": 0.19655713438987732,
      "rmse_dtheta": 0.03964567929506302,
      "rmse_dx": 0.008584078401327133,
      "rmse_dy": 0.009218825958669186,
      "rmse_mean": 0.019149528816342354,
      "rotation_flip": 0.007920792326331139,
      "sparse_tokens": 10266.0,
      "step": 6004,
      "turn_loss": 0.1952962577342987,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.2789908938858948,
      "grad_norm": 0.4592168629169464,
      "learning_rate": 5.074041564981578e-06,
      "loss": 0.085,
      "mae_dtheta": 0.016976725310087204,
      "mae_dx": 0.004449027590453625,
      "mae_dy": 0.0013856107834726572,
      "pose_mae_dtheta": 0.09813316911458969,
      "pose_mae_dx": 0.03204638510942459,
      "pose_mae_dy": 0.02242114208638668,
      "pose_rmse_dtheta": 0.16846208274364471,
      "pose_rmse_dx": 0.0821368470788002,
      "pose_rmse_dy": 0.07418383657932281,
      "pose_rmse_mean": 0.10826092958450317,
      "rmse_dtheta": 0.029172254726290703,
      "rmse_dx": 0.011634867638349533,
      "rmse_dy": 0.00314040994271636,
      "rmse_mean": 0.014649176970124245,
      "rotation_flip": 0.010582010261714458,
      "sparse_tokens": 4157.0,
      "step": 6005,
      "turn_loss": 0.14565519988536835,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2790373536517376,
      "grad_norm": 0.4187985062599182,
      "learning_rate": 5.072719488257915e-06,
      "loss": 0.0866,
      "mae_dtheta": 0.011433528736233711,
      "mae_dx": 0.0011868586298078299,
      "mae_dy": 0.002415817929431796,
      "pose_mae_dtheta": 0.07982222735881805,
      "pose_mae_dx": 0.019841652363538742,
      "pose_mae_dy": 0.034078199416399,
      "pose_rmse_dtheta": 0.20755375921726227,
      "pose_rmse_dx": 0.04938764497637749,
      "pose_rmse_dy": 0.08144986629486084,
      "pose_rmse_mean": 0.1127970963716507,
      "rmse_dtheta": 0.025346720591187477,
      "rmse_dx": 0.003420047927647829,
      "rmse_dy": 0.00552578829228878,
      "rmse_mean": 0.011430852115154266,
      "rotation_flip": 0.003941663540899754,
      "sparse_tokens": 32073.0,
      "step": 6006,
      "turn_loss": 0.07349850237369537,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2790838134175804,
      "grad_norm": 0.5003341436386108,
      "learning_rate": 5.071397406448937e-06,
      "loss": 0.073,
      "mae_dtheta": 0.00784531980752945,
      "mae_dx": 0.0020369223784655333,
      "mae_dy": 0.0016889984253793955,
      "pose_mae_dtheta": 0.05408983677625656,
      "pose_mae_dx": 0.0198865607380867,
      "pose_mae_dy": 0.018332868814468384,
      "pose_rmse_dtheta": 0.1610613316297531,
      "pose_rmse_dx": 0.05553225055336952,
      "pose_rmse_dy": 0.05304577946662903,
      "pose_rmse_mean": 0.08987979590892792,
      "rmse_dtheta": 0.021247146651148796,
      "rmse_dx": 0.006362752057611942,
      "rmse_dy": 0.004403975792229176,
      "rmse_mean": 0.010671291500329971,
      "rotation_flip": 0.005056179594248533,
      "sparse_tokens": 32105.0,
      "step": 6007,
      "turn_loss": 0.06917474418878555,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.27913027318342315,
      "grad_norm": 0.4037143290042877,
      "learning_rate": 5.070075319647101e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.007955088280141354,
      "mae_dx": 0.0011163128074258566,
      "mae_dy": 0.0016119176289066672,
      "pose_mae_dtheta": 0.05334218963980675,
      "pose_mae_dx": 0.016329877078533173,
      "pose_mae_dy": 0.019224263727664948,
      "pose_rmse_dtheta": 0.16967356204986572,
      "pose_rmse_dx": 0.045200545340776443,
      "pose_rmse_dy": 0.04440357908606529,
      "pose_rmse_mean": 0.08642589300870895,
      "rmse_dtheta": 0.019887510687112808,
      "rmse_dx": 0.003796960925683379,
      "rmse_dy": 0.0038312014658004045,
      "rmse_mean": 0.009171891957521439,
      "rotation_flip": 0.0028985508251935244,
      "sparse_tokens": 32057.0,
      "step": 6008,
      "turn_loss": 0.0523826889693737,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2791767329492659,
      "grad_norm": 0.40595000982284546,
      "learning_rate": 5.0687532279448605e-06,
      "loss": 0.1286,
      "mae_dtheta": 0.011126192286610603,
      "mae_dx": 0.002463101176545024,
      "mae_dy": 0.002443630713969469,
      "pose_mae_dtheta": 0.07508167624473572,
      "pose_mae_dx": 0.025192007422447205,
      "pose_mae_dy": 0.025876568630337715,
      "pose_rmse_dtheta": 0.207923024892807,
      "pose_rmse_dx": 0.057949211448431015,
      "pose_rmse_dy": 0.061618223786354065,
      "pose_rmse_mean": 0.10916348546743393,
      "rmse_dtheta": 0.025551415979862213,
      "rmse_dx": 0.007162545807659626,
      "rmse_dy": 0.006071600131690502,
      "rmse_mean": 0.012928521260619164,
      "rotation_flip": 0.005668016150593758,
      "sparse_tokens": 32105.0,
      "step": 6009,
      "turn_loss": 0.10019314289093018,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2792231927151087,
      "grad_norm": 0.49735888838768005,
      "learning_rate": 5.0674311314346705e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.0057147410698235035,
      "mae_dx": 0.0032648390624672174,
      "mae_dy": 0.0011776488972827792,
      "pose_mae_dtheta": 0.040902141481637955,
      "pose_mae_dx": 0.02960740216076374,
      "pose_mae_dy": 0.014022835530340672,
      "pose_rmse_dtheta": 0.12071797996759415,
      "pose_rmse_dx": 0.11216791719198227,
      "pose_rmse_dy": 0.03964870050549507,
      "pose_rmse_mean": 0.09084486961364746,
      "rmse_dtheta": 0.01587831601500511,
      "rmse_dx": 0.011843127198517323,
      "rmse_dy": 0.0036811623722314835,
      "rmse_mean": 0.010467534884810448,
      "rotation_flip": 0.0017452007159590721,
      "sparse_tokens": 32073.0,
      "step": 6010,
      "turn_loss": 0.05387360602617264,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.2792696524809515,
      "grad_norm": 0.4934556782245636,
      "learning_rate": 5.066109030208985e-06,
      "loss": 0.0981,
      "mae_dtheta": 0.036436840891838074,
      "mae_dx": 0.01673969440162182,
      "mae_dy": 0.006449483800679445,
      "pose_mae_dtheta": 0.2717334032058716,
      "pose_mae_dx": 0.13388432562351227,
      "pose_mae_dy": 0.07223299145698547,
      "pose_rmse_dtheta": 0.46982261538505554,
      "pose_rmse_dx": 0.2678323984146118,
      "pose_rmse_dy": 0.16207188367843628,
      "pose_rmse_mean": 0.29990899562835693,
      "rmse_dtheta": 0.053778573870658875,
      "rmse_dx": 0.030486147850751877,
      "rmse_dy": 0.01193294394761324,
      "rmse_mean": 0.03206589072942734,
      "rotation_flip": 0.00542005430907011,
      "sparse_tokens": 6053.0,
      "step": 6011,
      "turn_loss": 0.291042685508728,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.27931611224679426,
      "grad_norm": 0.43336331844329834,
      "learning_rate": 5.064786924360259e-06,
      "loss": 0.1263,
      "mae_dtheta": 0.007795816287398338,
      "mae_dx": 0.0015343097038567066,
      "mae_dy": 0.002055285032838583,
      "pose_mae_dtheta": 0.05429314076900482,
      "pose_mae_dx": 0.014278405345976353,
      "pose_mae_dy": 0.02276061475276947,
      "pose_rmse_dtheta": 0.14244255423545837,
      "pose_rmse_dx": 0.04074455425143242,
      "pose_rmse_dy": 0.06350940465927124,
      "pose_rmse_mean": 0.08223217725753784,
      "rmse_dtheta": 0.020829543471336365,
      "rmse_dx": 0.005241870414465666,
      "rmse_dy": 0.005957400426268578,
      "rmse_mean": 0.010676272213459015,
      "rotation_flip": 0.0030549897346645594,
      "sparse_tokens": 32089.0,
      "step": 6012,
      "turn_loss": 0.07537214457988739,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.27936257201263703,
      "grad_norm": 0.5440369248390198,
      "learning_rate": 5.063464813980948e-06,
      "loss": 0.0918,
      "mae_dtheta": 0.005371915176510811,
      "mae_dx": 0.0017860535299405456,
      "mae_dy": 0.0010607382282614708,
      "pose_mae_dtheta": 0.03781601041555405,
      "pose_mae_dx": 0.012196880765259266,
      "pose_mae_dy": 0.010504119098186493,
      "pose_rmse_dtheta": 0.14282192289829254,
      "pose_rmse_dx": 0.034695807844400406,
      "pose_rmse_dy": 0.03329256549477577,
      "pose_rmse_mean": 0.0702700987458229,
      "rmse_dtheta": 0.019105231389403343,
      "rmse_dx": 0.0065882024355232716,
      "rmse_dy": 0.005019424483180046,
      "rmse_mean": 0.010237619280815125,
      "rotation_flip": 0.0023501762188971043,
      "sparse_tokens": 32169.0,
      "step": 6013,
      "turn_loss": 0.05209651216864586,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.2794090317784798,
      "grad_norm": 0.48880496621131897,
      "learning_rate": 5.062142699163509e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.02477458119392395,
      "mae_dx": 0.004934045020490885,
      "mae_dy": 0.005796659737825394,
      "pose_mae_dtheta": 0.1723523885011673,
      "pose_mae_dx": 0.04722347483038902,
      "pose_mae_dy": 0.061342958360910416,
      "pose_rmse_dtheta": 0.2989457845687866,
      "pose_rmse_dx": 0.0982678160071373,
      "pose_rmse_dy": 0.11937496066093445,
      "pose_rmse_mean": 0.1721961945295334,
      "rmse_dtheta": 0.037681229412555695,
      "rmse_dx": 0.011745085939764977,
      "rmse_dy": 0.00919704046100378,
      "rmse_mean": 0.019541120156645775,
      "rotation_flip": 0.01133144460618496,
      "sparse_tokens": 5402.0,
      "step": 6014,
      "turn_loss": 0.2655700743198395,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.27945549154432264,
      "grad_norm": 0.6891748905181885,
      "learning_rate": 5.0608205800003985e-06,
      "loss": 0.1621,
      "mae_dtheta": 0.009056025184690952,
      "mae_dx": 0.0013194449711591005,
      "mae_dy": 0.002361693186685443,
      "pose_mae_dtheta": 0.054894931614398956,
      "pose_mae_dx": 0.0179279837757349,
      "pose_mae_dy": 0.022297602146863937,
      "pose_rmse_dtheta": 0.14749841392040253,
      "pose_rmse_dx": 0.050534673035144806,
      "pose_rmse_dy": 0.06079816073179245,
      "pose_rmse_mean": 0.08627709001302719,
      "rmse_dtheta": 0.022097628563642502,
      "rmse_dx": 0.0035501918755471706,
      "rmse_dy": 0.005813320633023977,
      "rmse_mean": 0.010487047955393791,
      "rotation_flip": 0.0024449878837913275,
      "sparse_tokens": 32073.0,
      "step": 6015,
      "turn_loss": 0.06830801069736481,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.2795019513101654,
      "grad_norm": 0.6663417816162109,
      "learning_rate": 5.059498456584072e-06,
      "loss": 0.1923,
      "mae_dtheta": 0.039624445140361786,
      "mae_dx": 0.01426244992762804,
      "mae_dy": 0.00525474501773715,
      "pose_mae_dtheta": 0.2987816333770752,
      "pose_mae_dx": 0.11020752787590027,
      "pose_mae_dy": 0.05873076617717743,
      "pose_rmse_dtheta": 0.5071524977684021,
      "pose_rmse_dx": 0.24225381016731262,
      "pose_rmse_dy": 0.13297519087791443,
      "pose_rmse_mean": 0.2941271960735321,
      "rmse_dtheta": 0.056912124156951904,
      "rmse_dx": 0.027220647782087326,
      "rmse_dy": 0.010658781044185162,
      "rmse_mean": 0.031597185879945755,
      "rotation_flip": 0.017069701105356216,
      "sparse_tokens": 11550.0,
      "step": 6016,
      "turn_loss": 0.3136419355869293,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2795484110760082,
      "grad_norm": 0.49707144498825073,
      "learning_rate": 5.0581763290069865e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.013387101702392101,
      "mae_dx": 0.001710409764200449,
      "mae_dy": 0.0033772175665944815,
      "pose_mae_dtheta": 0.08441063016653061,
      "pose_mae_dx": 0.023001311346888542,
      "pose_mae_dy": 0.034068893641233444,
      "pose_rmse_dtheta": 0.19537410140037537,
      "pose_rmse_dx": 0.05944016948342323,
      "pose_rmse_dy": 0.09755245596170425,
      "pose_rmse_mean": 0.11745557188987732,
      "rmse_dtheta": 0.02671559900045395,
      "rmse_dx": 0.0047945925034582615,
      "rmse_dy": 0.007968032732605934,
      "rmse_mean": 0.013159409165382385,
      "rotation_flip": 0.0035765378270298243,
      "sparse_tokens": 32105.0,
      "step": 6017,
      "turn_loss": 0.10308654606342316,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.279594870841851,
      "grad_norm": 0.4183942377567291,
      "learning_rate": 5.056854197361598e-06,
      "loss": 0.0827,
      "mae_dtheta": 0.009588249959051609,
      "mae_dx": 0.0015009318012744188,
      "mae_dy": 0.0018442077562212944,
      "pose_mae_dtheta": 0.06602605432271957,
      "pose_mae_dx": 0.020719822496175766,
      "pose_mae_dy": 0.025644805282354355,
      "pose_rmse_dtheta": 0.15711557865142822,
      "pose_rmse_dx": 0.05956064537167549,
      "pose_rmse_dy": 0.06156465411186218,
      "pose_rmse_mean": 0.09274695813655853,
      "rmse_dtheta": 0.02099551446735859,
      "rmse_dx": 0.005590689834207296,
      "rmse_dy": 0.004196023568511009,
      "rmse_mean": 0.010260743089020252,
      "rotation_flip": 0.0049683828838169575,
      "sparse_tokens": 32057.0,
      "step": 6018,
      "turn_loss": 0.07471860200166702,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.27964133060769375,
      "grad_norm": 0.5488767027854919,
      "learning_rate": 5.055532061740367e-06,
      "loss": 0.0875,
      "mae_dtheta": 0.0076569970697164536,
      "mae_dx": 0.0016502153594046831,
      "mae_dy": 0.001044298755005002,
      "pose_mae_dtheta": 0.05609069764614105,
      "pose_mae_dx": 0.017228497192263603,
      "pose_mae_dy": 0.013316284865140915,
      "pose_rmse_dtheta": 0.208215594291687,
      "pose_rmse_dx": 0.046366382390260696,
      "pose_rmse_dy": 0.047002412378787994,
      "pose_rmse_mean": 0.10052813589572906,
      "rmse_dtheta": 0.0234023779630661,
      "rmse_dx": 0.0045248279348015785,
      "rmse_dy": 0.00296212756074965,
      "rmse_mean": 0.010296444408595562,
      "rotation_flip": 0.0063931806944310665,
      "sparse_tokens": 32169.0,
      "step": 6019,
      "turn_loss": 0.05598033219575882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.2796877903735365,
      "grad_norm": 0.5364011526107788,
      "learning_rate": 5.054209922235746e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.033420637249946594,
      "mae_dx": 0.01666538044810295,
      "mae_dy": 0.003983538597822189,
      "pose_mae_dtheta": 0.27392277121543884,
      "pose_mae_dx": 0.1430332213640213,
      "pose_mae_dy": 0.058233413845300674,
      "pose_rmse_dtheta": 0.4644201099872589,
      "pose_rmse_dx": 0.29165738821029663,
      "pose_rmse_dy": 0.11648494750261307,
      "pose_rmse_mean": 0.29085415601730347,
      "rmse_dtheta": 0.050631314516067505,
      "rmse_dx": 0.029616599902510643,
      "rmse_dy": 0.007298820186406374,
      "rmse_mean": 0.029182245954871178,
      "rotation_flip": 0.00929368007928133,
      "sparse_tokens": 9682.0,
      "step": 6020,
      "turn_loss": 0.30506110191345215,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.2797342501393793,
      "grad_norm": 0.7132604122161865,
      "learning_rate": 5.052887778940199e-06,
      "loss": 0.1307,
      "mae_dtheta": 0.01399021502584219,
      "mae_dx": 0.0043224915862083435,
      "mae_dy": 0.0019629751332104206,
      "pose_mae_dtheta": 0.10779252648353577,
      "pose_mae_dx": 0.030726339668035507,
      "pose_mae_dy": 0.015274429693818092,
      "pose_rmse_dtheta": 0.1963316798210144,
      "pose_rmse_dx": 0.0705256387591362,
      "pose_rmse_dy": 0.05017693713307381,
      "pose_rmse_mean": 0.10567809641361237,
      "rmse_dtheta": 0.026784203946590424,
      "rmse_dx": 0.010847874917089939,
      "rmse_dy": 0.004454625304788351,
      "rmse_mean": 0.014028901234269142,
      "rotation_flip": 0.021978022530674934,
      "sparse_tokens": 6243.0,
      "step": 6021,
      "turn_loss": 0.1385333389043808,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.2797807099052221,
      "grad_norm": 0.49916642904281616,
      "learning_rate": 5.051565631946179e-06,
      "loss": 0.1086,
      "mae_dtheta": 0.010966500267386436,
      "mae_dx": 0.0035476810298860073,
      "mae_dy": 0.0009893951937556267,
      "pose_mae_dtheta": 0.07464363425970078,
      "pose_mae_dx": 0.031023090705275536,
      "pose_mae_dy": 0.013840257190167904,
      "pose_rmse_dtheta": 0.2170943319797516,
      "pose_rmse_dx": 0.08139044791460037,
      "pose_rmse_dy": 0.04113524407148361,
      "pose_rmse_mean": 0.11320667713880539,
      "rmse_dtheta": 0.02829093299806118,
      "rmse_dx": 0.009616443887352943,
      "rmse_dy": 0.0024932927917689085,
      "rmse_mean": 0.013466889970004559,
      "rotation_flip": 0.0038554216735064983,
      "sparse_tokens": 32233.0,
      "step": 6022,
      "turn_loss": 0.09759689122438431,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31369.0,
      "epoch": 0.27982716967106486,
      "grad_norm": 0.5213190317153931,
      "learning_rate": 5.0502434813461485e-06,
      "loss": 0.1437,
      "mae_dtheta": 0.029882552102208138,
      "mae_dx": 0.012506701052188873,
      "mae_dy": 0.0043834513053298,
      "pose_mae_dtheta": 0.23278729617595673,
      "pose_mae_dx": 0.09822725504636765,
      "pose_mae_dy": 0.057952772825956345,
      "pose_rmse_dtheta": 0.43552181124687195,
      "pose_rmse_dx": 0.2284902185201645,
      "pose_rmse_dy": 0.13329964876174927,
      "pose_rmse_mean": 0.2657705545425415,
      "rmse_dtheta": 0.04750003293156624,
      "rmse_dx": 0.0259886234998703,
      "rmse_dy": 0.00814284197986126,
      "rmse_mean": 0.027210500091314316,
      "rotation_flip": 0.02280130237340927,
      "sparse_tokens": 25364.0,
      "step": 6023,
      "turn_loss": 0.25074395537376404,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.27987362943690763,
      "grad_norm": 0.9505782723426819,
      "learning_rate": 5.048921327232563e-06,
      "loss": 0.2716,
      "mae_dtheta": 0.03669997677206993,
      "mae_dx": 0.01050341036170721,
      "mae_dy": 0.005067573860287666,
      "pose_mae_dtheta": 0.26025494933128357,
      "pose_mae_dx": 0.09089396893978119,
      "pose_mae_dy": 0.06350767612457275,
      "pose_rmse_dtheta": 0.503424346446991,
      "pose_rmse_dx": 0.16967876255512238,
      "pose_rmse_dy": 0.11825082451105118,
      "pose_rmse_mean": 0.26378464698791504,
      "rmse_dtheta": 0.05584264174103737,
      "rmse_dx": 0.022179340943694115,
      "rmse_dy": 0.008787109516561031,
      "rmse_mean": 0.028936363756656647,
      "rotation_flip": 0.018518518656492233,
      "sparse_tokens": 3472.0,
      "step": 6024,
      "turn_loss": 0.23691576719284058,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2799200892027504,
      "grad_norm": 0.5447030663490295,
      "learning_rate": 5.0475991696978844e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.010443218052387238,
      "mae_dx": 0.0013999415095895529,
      "mae_dy": 0.0022123102098703384,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5447030067443848,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.80589294433594,
      "model/head/act_norm_mean": 111.43793402777777,
      "model/head/act_norm_min": 65.97149658203125,
      "model/head/act_over_embed": 76.58119156226469,
      "model/head/grad_frac": 0.11085245758295059,
      "model/head/grad_norm": 0.06038166582584381,
      "model/head/grad_zero_frac": 0.00017608582857064903,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7021878945707071,
      "model/head/update_ratio": 0.0010316226398572326,
      "model/head/weight_delta": 8.940272331237793,
      "model/head/weight_delta_rel": 0.15683886408805847,
      "model/head/weight_norm": 58.530765533447266,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42082497477531433,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4207602108226103,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.420683354139328,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2891503560964549,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11547135561704636,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06289759278297424,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5320630656108597,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002032817807048559,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9021151065826416,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09482114762067795,
      "model/modality_embedder.encoders.pose/weight_norm": 30.941085815429688,
      "model/modality_embedder/grad_frac": 0.11547135561704636,
      "model/modality_embedder/grad_norm": 0.06289759278297424,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5320630656108597,
      "model/modality_embedder/update_ratio": 0.002032817807048559,
      "model/modality_embedder/weight_delta": 2.9021151065826416,
      "model/modality_embedder/weight_delta_rel": 0.09482114762067795,
      "model/modality_embedder/weight_norm": 30.941085815429688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.6910400390625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.756721480679815,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.038799285888672,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.32584141545386,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08381880074739456,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04565635323524475,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016387409996241331,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.2806694507598877,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08310896903276443,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.860628128051758,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.44505310058594,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.78733014670515,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.294414520263672,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.03408533945682,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08958809822797775,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04879890754818916,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016482480568811297,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.8903181552886963,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10012287646532059,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.606531143188477,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.33087921142578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.683982683982684,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.433863639831543,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.337482719814755,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09191527217626572,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.050066523253917694,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016378979198634624,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.1167638301849365,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10465509444475174,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.567548751831055,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.01803588867188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.48618125701459,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.536249160766602,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.575970451651152,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09349546581506729,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.050927262753248215,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017076284857466817,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.662436008453369,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09098942577838898,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.82338523864746,
      "model/normalizer/grad_frac": 0.3394804298877716,
      "model/normalizer/grad_norm": 0.18491600453853607,
      "model/normalizer/grad_zero_frac": 0.00016662511916365474,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002356413286179304,
      "model/normalizer/weight_delta": 5.638340950012207,
      "model/normalizer/weight_delta_rel": 0.07261856645345688,
      "model/normalizer/weight_norm": 78.47350311279297,
      "pose_mae_dtheta": 0.068575918674469,
      "pose_mae_dx": 0.020284725353121758,
      "pose_mae_dy": 0.024979237467050552,
      "pose_rmse_dtheta": 0.18675366044044495,
      "pose_rmse_dx": 0.05241703242063522,
      "pose_rmse_dy": 0.0570237971842289,
      "pose_rmse_mean": 0.09873150289058685,
      "rmse_dtheta": 0.02335374616086483,
      "rmse_dx": 0.003994136583060026,
      "rmse_dy": 0.004574439488351345,
      "rmse_mean": 0.010640773922204971,
      "rotation_flip": 0.005826657172292471,
      "sparse_tokens": 32089.0,
      "step": 6025,
      "turn_loss": 0.07270701974630356,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2799665489685932,
      "grad_norm": 0.4564805328845978,
      "learning_rate": 5.046277008834568e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.007786296308040619,
      "mae_dx": 0.0014185653999447823,
      "mae_dy": 0.0010036546736955643,
      "pose_mae_dtheta": 0.06309028714895248,
      "pose_mae_dx": 0.015901856124401093,
      "pose_mae_dy": 0.019592532888054848,
      "pose_rmse_dtheta": 0.21299007534980774,
      "pose_rmse_dx": 0.04826704040169716,
      "pose_rmse_dy": 0.06488750874996185,
      "pose_rmse_mean": 0.10871487855911255,
      "rmse_dtheta": 0.023542357608675957,
      "rmse_dx": 0.004840320907533169,
      "rmse_dy": 0.002372086513787508,
      "rmse_mean": 0.010251588188111782,
      "rotation_flip": 0.001490312977693975,
      "sparse_tokens": 32089.0,
      "step": 6026,
      "turn_loss": 0.046275533735752106,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.28001300873443596,
      "grad_norm": 0.46716660261154175,
      "learning_rate": 5.044954844735077e-06,
      "loss": 0.1028,
      "mae_dtheta": 0.009395615197718143,
      "mae_dx": 0.0013606372522190213,
      "mae_dy": 0.001709111500531435,
      "pose_mae_dtheta": 0.06181646138429642,
      "pose_mae_dx": 0.0168045274913311,
      "pose_mae_dy": 0.02105913683772087,
      "pose_rmse_dtheta": 0.1748260259628296,
      "pose_rmse_dx": 0.04326122999191284,
      "pose_rmse_dy": 0.051146458834409714,
      "pose_rmse_mean": 0.08974456787109375,
      "rmse_dtheta": 0.024409480392932892,
      "rmse_dx": 0.003953882958739996,
      "rmse_dy": 0.004648262169212103,
      "rmse_mean": 0.011003876104950905,
      "rotation_flip": 0.0033914728555828333,
      "sparse_tokens": 32105.0,
      "step": 6027,
      "turn_loss": 0.079634889960289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.28005946850027874,
      "grad_norm": 0.6921101808547974,
      "learning_rate": 5.04363267749187e-06,
      "loss": 0.1879,
      "mae_dtheta": 0.02818465605378151,
      "mae_dx": 0.009960454888641834,
      "mae_dy": 0.0038996576331555843,
      "pose_mae_dtheta": 0.21083606779575348,
      "pose_mae_dx": 0.08070583641529083,
      "pose_mae_dy": 0.040394045412540436,
      "pose_rmse_dtheta": 0.37992921471595764,
      "pose_rmse_dx": 0.16670435667037964,
      "pose_rmse_dy": 0.09379186481237411,
      "pose_rmse_mean": 0.21347515285015106,
      "rmse_dtheta": 0.045738741755485535,
      "rmse_dx": 0.02049819380044937,
      "rmse_dy": 0.008732263930141926,
      "rmse_mean": 0.024989735335111618,
      "rotation_flip": 0.022767074406147003,
      "sparse_tokens": 10162.0,
      "step": 6028,
      "turn_loss": 0.24682191014289856,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2801059282661215,
      "grad_norm": 0.6044558882713318,
      "learning_rate": 5.042310507197405e-06,
      "loss": 0.1206,
      "mae_dtheta": 0.012872107326984406,
      "mae_dx": 0.002095927018672228,
      "mae_dy": 0.003873364767059684,
      "pose_mae_dtheta": 0.09355221688747406,
      "pose_mae_dx": 0.029973501339554787,
      "pose_mae_dy": 0.033829234540462494,
      "pose_rmse_dtheta": 0.23642680048942566,
      "pose_rmse_dx": 0.09109476953744888,
      "pose_rmse_dy": 0.08064542710781097,
      "pose_rmse_mean": 0.13605567812919617,
      "rmse_dtheta": 0.027255292981863022,
      "rmse_dx": 0.0053861020132899284,
      "rmse_dy": 0.0095407385379076,
      "rmse_mean": 0.014060711488127708,
      "rotation_flip": 0.004823151044547558,
      "sparse_tokens": 32089.0,
      "step": 6029,
      "turn_loss": 0.10436811298131943,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2801523880319643,
      "grad_norm": 0.5085351467132568,
      "learning_rate": 5.040988333944146e-06,
      "loss": 0.1314,
      "mae_dtheta": 0.010348135605454445,
      "mae_dx": 0.0017257732106372714,
      "mae_dy": 0.00265710917301476,
      "pose_mae_dtheta": 0.06360769271850586,
      "pose_mae_dx": 0.022168517112731934,
      "pose_mae_dy": 0.026593118906021118,
      "pose_rmse_dtheta": 0.14367040991783142,
      "pose_rmse_dx": 0.05529441684484482,
      "pose_rmse_dy": 0.05822654440999031,
      "pose_rmse_mean": 0.08573046326637268,
      "rmse_dtheta": 0.022185970097780228,
      "rmse_dx": 0.004325492307543755,
      "rmse_dy": 0.005589021369814873,
      "rmse_mean": 0.010700161568820477,
      "rotation_flip": 0.007444168906658888,
      "sparse_tokens": 32153.0,
      "step": 6030,
      "turn_loss": 0.09083080291748047,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15220.0,
      "epoch": 0.2801988477978071,
      "grad_norm": 1.029918909072876,
      "learning_rate": 5.039666157824549e-06,
      "loss": 0.2688,
      "mae_dtheta": 0.034887347370386124,
      "mae_dx": 0.009348195977509022,
      "mae_dy": 0.0027354469057172537,
      "pose_mae_dtheta": 0.29222893714904785,
      "pose_mae_dx": 0.08192506432533264,
      "pose_mae_dy": 0.035738036036491394,
      "pose_rmse_dtheta": 0.5383512377738953,
      "pose_rmse_dx": 0.2087179273366928,
      "pose_rmse_dy": 0.09901810437440872,
      "pose_rmse_mean": 0.28202909231185913,
      "rmse_dtheta": 0.05583116412162781,
      "rmse_dx": 0.021191352978348732,
      "rmse_dy": 0.0057916585355997086,
      "rmse_mean": 0.02760472521185875,
      "rotation_flip": 0.007849293760955334,
      "sparse_tokens": 12132.0,
      "step": 6031,
      "turn_loss": 0.2153024673461914,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.2802453075636499,
      "grad_norm": 0.5682294964790344,
      "learning_rate": 5.038343978931076e-06,
      "loss": 0.1285,
      "mae_dtheta": 0.01879517361521721,
      "mae_dx": 0.004194494336843491,
      "mae_dy": 0.0093451589345932,
      "pose_mae_dtheta": 0.1403580754995346,
      "pose_mae_dx": 0.059132739901542664,
      "pose_mae_dy": 0.0984129086136818,
      "pose_rmse_dtheta": 0.2323927879333496,
      "pose_rmse_dx": 0.1683526337146759,
      "pose_rmse_dy": 0.20310162007808685,
      "pose_rmse_mean": 0.2012823522090912,
      "rmse_dtheta": 0.03323111683130264,
      "rmse_dx": 0.011090732179582119,
      "rmse_dy": 0.024508090689778328,
      "rmse_mean": 0.022943314164876938,
      "rotation_flip": 0.013452914543449879,
      "sparse_tokens": 5754.0,
      "step": 6032,
      "turn_loss": 0.17286114394664764,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.2802917673294927,
      "grad_norm": 0.35151806473731995,
      "learning_rate": 5.03702179735619e-06,
      "loss": 0.1102,
      "mae_dtheta": 0.025059908628463745,
      "mae_dx": 0.007582832593470812,
      "mae_dy": 0.005393370985984802,
      "pose_mae_dtheta": 0.18430757522583008,
      "pose_mae_dx": 0.05867443606257439,
      "pose_mae_dy": 0.05592157319188118,
      "pose_rmse_dtheta": 0.35254961252212524,
      "pose_rmse_dx": 0.1463271677494049,
      "pose_rmse_dy": 0.12663769721984863,
      "pose_rmse_mean": 0.2085048407316208,
      "rmse_dtheta": 0.041226185858249664,
      "rmse_dx": 0.017200525850057602,
      "rmse_dy": 0.01067598257213831,
      "rmse_mean": 0.0230342335999012,
      "rotation_flip": 0.014324082061648369,
      "sparse_tokens": 20156.0,
      "step": 6033,
      "turn_loss": 0.23233510553836823,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.28033822709533546,
      "grad_norm": 0.5474661588668823,
      "learning_rate": 5.035699613192348e-06,
      "loss": 0.094,
      "mae_dtheta": 0.007440043613314629,
      "mae_dx": 0.0016357763670384884,
      "mae_dy": 0.002031630137935281,
      "pose_mae_dtheta": 0.04750688001513481,
      "pose_mae_dx": 0.021460527554154396,
      "pose_mae_dy": 0.02026975154876709,
      "pose_rmse_dtheta": 0.11226246505975723,
      "pose_rmse_dx": 0.0618077777326107,
      "pose_rmse_dy": 0.04735047370195389,
      "pose_rmse_mean": 0.07380690425634384,
      "rmse_dtheta": 0.017232466489076614,
      "rmse_dx": 0.00461198715493083,
      "rmse_dy": 0.005237292498350143,
      "rmse_mean": 0.009027249179780483,
      "rotation_flip": 0.004101722501218319,
      "sparse_tokens": 32105.0,
      "step": 6034,
      "turn_loss": 0.06416946649551392,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25235.0,
      "epoch": 0.28038468686117823,
      "grad_norm": 0.771367073059082,
      "learning_rate": 5.0343774265320134e-06,
      "loss": 0.1871,
      "mae_dtheta": 0.04011975973844528,
      "mae_dx": 0.016180813312530518,
      "mae_dy": 0.0034279453102499247,
      "pose_mae_dtheta": 0.35582205653190613,
      "pose_mae_dx": 0.12397878617048264,
      "pose_mae_dy": 0.04292356222867966,
      "pose_rmse_dtheta": 0.5490126609802246,
      "pose_rmse_dx": 0.2549765110015869,
      "pose_rmse_dy": 0.10906804352998734,
      "pose_rmse_mean": 0.30435240268707275,
      "rmse_dtheta": 0.05774269625544548,
      "rmse_dx": 0.028750866651535034,
      "rmse_dy": 0.007026419509202242,
      "rmse_mean": 0.031173329800367355,
      "rotation_flip": 0.014766201376914978,
      "sparse_tokens": 19022.0,
      "step": 6035,
      "turn_loss": 0.32679107785224915,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.280431146627021,
      "grad_norm": 0.5046817064285278,
      "learning_rate": 5.033055237467646e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.012509208172559738,
      "mae_dx": 0.002590683288872242,
      "mae_dy": 0.0026923096738755703,
      "pose_mae_dtheta": 0.08525507897138596,
      "pose_mae_dx": 0.032213255763053894,
      "pose_mae_dy": 0.03770992159843445,
      "pose_rmse_dtheta": 0.1770116537809372,
      "pose_rmse_dx": 0.08591814339160919,
      "pose_rmse_dy": 0.0834907814860344,
      "pose_rmse_mean": 0.11547353118658066,
      "rmse_dtheta": 0.024568304419517517,
      "rmse_dx": 0.00832569133490324,
      "rmse_dy": 0.005956688895821571,
      "rmse_mean": 0.012950229458510876,
      "rotation_flip": 0.00358422938734293,
      "sparse_tokens": 32057.0,
      "step": 6036,
      "turn_loss": 0.12758775055408478,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2804776063928638,
      "grad_norm": 0.43105289340019226,
      "learning_rate": 5.03173304609171e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.0072190179489552975,
      "mae_dx": 0.0012904539471492171,
      "mae_dy": 0.001581565709784627,
      "pose_mae_dtheta": 0.04881277680397034,
      "pose_mae_dx": 0.013796895742416382,
      "pose_mae_dy": 0.02105138450860977,
      "pose_rmse_dtheta": 0.10959566384553909,
      "pose_rmse_dx": 0.029830364510416985,
      "pose_rmse_dy": 0.06150670722126961,
      "pose_rmse_mean": 0.06697757542133331,
      "rmse_dtheta": 0.01589522883296013,
      "rmse_dx": 0.003496931167319417,
      "rmse_dy": 0.003676748601719737,
      "rmse_mean": 0.007689636200666428,
      "rotation_flip": 0.010212097316980362,
      "sparse_tokens": 32169.0,
      "step": 6037,
      "turn_loss": 0.06062047556042671,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.28052406615870656,
      "grad_norm": 0.545311450958252,
      "learning_rate": 5.030410852496665e-06,
      "loss": 0.0979,
      "mae_dtheta": 0.0124531714245677,
      "mae_dx": 0.00217431946657598,
      "mae_dy": 0.003152328310534358,
      "pose_mae_dtheta": 0.09063693881034851,
      "pose_mae_dx": 0.02770419977605343,
      "pose_mae_dy": 0.03859078884124756,
      "pose_rmse_dtheta": 0.20319904386997223,
      "pose_rmse_dx": 0.071086086332798,
      "pose_rmse_dy": 0.08952053636312485,
      "pose_rmse_mean": 0.12126856297254562,
      "rmse_dtheta": 0.024755623191595078,
      "rmse_dx": 0.007684577722102404,
      "rmse_dy": 0.007007565349340439,
      "rmse_mean": 0.013149255886673927,
      "rotation_flip": 0.008380952291190624,
      "sparse_tokens": 32057.0,
      "step": 6038,
      "turn_loss": 0.11402696371078491,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32662.0,
      "epoch": 0.28057052592454934,
      "grad_norm": 0.8336197733879089,
      "learning_rate": 5.02908865677497e-06,
      "loss": 0.2708,
      "mae_dtheta": 0.031953081488609314,
      "mae_dx": 0.01134139858186245,
      "mae_dy": 0.004913224373012781,
      "pose_mae_dtheta": 0.23703305423259735,
      "pose_mae_dx": 0.0912512019276619,
      "pose_mae_dy": 0.06066863611340523,
      "pose_rmse_dtheta": 0.447478324174881,
      "pose_rmse_dx": 0.2051670402288437,
      "pose_rmse_dy": 0.1574985682964325,
      "pose_rmse_mean": 0.27004799246788025,
      "rmse_dtheta": 0.05088351294398308,
      "rmse_dx": 0.023286674171686172,
      "rmse_dy": 0.010771472007036209,
      "rmse_mean": 0.028313886374235153,
      "rotation_flip": 0.011378848925232887,
      "sparse_tokens": 24930.0,
      "step": 6039,
      "turn_loss": 0.25292572379112244,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2806169856903921,
      "grad_norm": 0.3998098373413086,
      "learning_rate": 5.027766459019091e-06,
      "loss": 0.1172,
      "mae_dtheta": 0.009842630475759506,
      "mae_dx": 0.0014605759643018246,
      "mae_dy": 0.002329820767045021,
      "pose_mae_dtheta": 0.06427304446697235,
      "pose_mae_dx": 0.022211365401744843,
      "pose_mae_dy": 0.029253194108605385,
      "pose_rmse_dtheta": 0.12779733538627625,
      "pose_rmse_dx": 0.05121464282274246,
      "pose_rmse_dy": 0.06370559334754944,
      "pose_rmse_mean": 0.08090585470199585,
      "rmse_dtheta": 0.01887221448123455,
      "rmse_dx": 0.004138476215302944,
      "rmse_dy": 0.004736913368105888,
      "rmse_mean": 0.00924920104444027,
      "rotation_flip": 0.005261311773210764,
      "sparse_tokens": 32121.0,
      "step": 6040,
      "turn_loss": 0.0803140327334404,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2806634454562349,
      "grad_norm": 0.39700251817703247,
      "learning_rate": 5.026444259321489e-06,
      "loss": 0.0935,
      "mae_dtheta": 0.007736832834780216,
      "mae_dx": 0.001404623850248754,
      "mae_dy": 0.001645857933908701,
      "pose_mae_dtheta": 0.05548788234591484,
      "pose_mae_dx": 0.01609700545668602,
      "pose_mae_dy": 0.02315339632332325,
      "pose_rmse_dtheta": 0.13296930491924286,
      "pose_rmse_dx": 0.04307957738637924,
      "pose_rmse_dy": 0.06517729163169861,
      "pose_rmse_mean": 0.0804087221622467,
      "rmse_dtheta": 0.01699121482670307,
      "rmse_dx": 0.004672087728977203,
      "rmse_dy": 0.003942851908504963,
      "rmse_mean": 0.008535385131835938,
      "rotation_flip": 0.004440497141331434,
      "sparse_tokens": 32121.0,
      "step": 6041,
      "turn_loss": 0.06076909601688385,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36663.0,
      "epoch": 0.28070990522207767,
      "grad_norm": 0.5356081128120422,
      "learning_rate": 5.025122057774626e-06,
      "loss": 0.1571,
      "mae_dtheta": 0.029953893274068832,
      "mae_dx": 0.009312842972576618,
      "mae_dy": 0.004003967624157667,
      "pose_mae_dtheta": 0.22094805538654327,
      "pose_mae_dx": 0.0659027099609375,
      "pose_mae_dy": 0.05162481963634491,
      "pose_rmse_dtheta": 0.41697022318840027,
      "pose_rmse_dx": 0.16261178255081177,
      "pose_rmse_dy": 0.15044069290161133,
      "pose_rmse_mean": 0.2433408945798874,
      "rmse_dtheta": 0.049253955483436584,
      "rmse_dx": 0.020892499014735222,
      "rmse_dy": 0.009501478634774685,
      "rmse_mean": 0.026549313217401505,
      "rotation_flip": 0.008573178201913834,
      "sparse_tokens": 27478.0,
      "step": 6042,
      "turn_loss": 0.23781758546829224,
      "turns": 113.0,
      "turns_per_sample": 113.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.28075636498792045,
      "grad_norm": 0.671491801738739,
      "learning_rate": 5.023799854470963e-06,
      "loss": 0.1264,
      "mae_dtheta": 0.046128418296575546,
      "mae_dx": 0.018116837367415428,
      "mae_dy": 0.004498650319874287,
      "pose_mae_dtheta": 0.36566755175590515,
      "pose_mae_dx": 0.14251574873924255,
      "pose_mae_dy": 0.04810537397861481,
      "pose_rmse_dtheta": 0.6389341354370117,
      "pose_rmse_dx": 0.2901001572608948,
      "pose_rmse_dy": 0.11331158131361008,
      "pose_rmse_mean": 0.3474486470222473,
      "rmse_dtheta": 0.06546557694673538,
      "rmse_dx": 0.031635481864213943,
      "rmse_dy": 0.009142927825450897,
      "rmse_mean": 0.035414665937423706,
      "rotation_flip": 0.010852713137865067,
      "sparse_tokens": 10053.0,
      "step": 6043,
      "turn_loss": 0.25752508640289307,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2808028247537632,
      "grad_norm": 0.4924257695674896,
      "learning_rate": 5.022477649502965e-06,
      "loss": 0.0949,
      "mae_dtheta": 0.011050899513065815,
      "mae_dx": 0.0014944791328161955,
      "mae_dy": 0.002276147948578,
      "pose_mae_dtheta": 0.07539737224578857,
      "pose_mae_dx": 0.02180580236017704,
      "pose_mae_dy": 0.028108399361371994,
      "pose_rmse_dtheta": 0.22045396268367767,
      "pose_rmse_dx": 0.05306620895862579,
      "pose_rmse_dy": 0.07519514858722687,
      "pose_rmse_mean": 0.11623843759298325,
      "rmse_dtheta": 0.025825271382927895,
      "rmse_dx": 0.004113984294235706,
      "rmse_dy": 0.005768611095845699,
      "rmse_mean": 0.011902622878551483,
      "rotation_flip": 0.006936416029930115,
      "sparse_tokens": 32105.0,
      "step": 6044,
      "turn_loss": 0.09160581976175308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.280849284519606,
      "grad_norm": 0.43909233808517456,
      "learning_rate": 5.021155442963093e-06,
      "loss": 0.1171,
      "mae_dtheta": 0.040254052728414536,
      "mae_dx": 0.01331708300858736,
      "mae_dy": 0.004779804963618517,
      "pose_mae_dtheta": 0.31782129406929016,
      "pose_mae_dx": 0.10883497446775436,
      "pose_mae_dy": 0.06424358487129211,
      "pose_rmse_dtheta": 0.5439761877059937,
      "pose_rmse_dx": 0.2282157689332962,
      "pose_rmse_dy": 0.16566884517669678,
      "pose_rmse_mean": 0.31262028217315674,
      "rmse_dtheta": 0.05917191132903099,
      "rmse_dx": 0.025818251073360443,
      "rmse_dy": 0.010937976650893688,
      "rmse_mean": 0.03197604417800903,
      "rotation_flip": 0.010022271424531937,
      "sparse_tokens": 13623.0,
      "step": 6045,
      "turn_loss": 0.3352055847644806,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2808957442854488,
      "grad_norm": 0.3781561255455017,
      "learning_rate": 5.019833234943806e-06,
      "loss": 0.0789,
      "mae_dtheta": 0.009135431610047817,
      "mae_dx": 0.0019353823736310005,
      "mae_dy": 0.0022528553381562233,
      "pose_mae_dtheta": 0.06357705593109131,
      "pose_mae_dx": 0.022076357156038284,
      "pose_mae_dy": 0.023469170555472374,
      "pose_rmse_dtheta": 0.15685661137104034,
      "pose_rmse_dx": 0.056166596710681915,
      "pose_rmse_dy": 0.07479526847600937,
      "pose_rmse_mean": 0.095939502120018,
      "rmse_dtheta": 0.021939469501376152,
      "rmse_dx": 0.005278757773339748,
      "rmse_dy": 0.005322878248989582,
      "rmse_mean": 0.010847034864127636,
      "rotation_flip": 0.0036674817092716694,
      "sparse_tokens": 32121.0,
      "step": 6046,
      "turn_loss": 0.0721861720085144,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.28094220405129156,
      "grad_norm": 0.5125896334648132,
      "learning_rate": 5.018511025537574e-06,
      "loss": 0.112,
      "mae_dtheta": 0.009257450699806213,
      "mae_dx": 0.002206405159085989,
      "mae_dy": 0.001919107511639595,
      "pose_mae_dtheta": 0.0675448402762413,
      "pose_mae_dx": 0.02550586313009262,
      "pose_mae_dy": 0.024199288338422775,
      "pose_rmse_dtheta": 0.1663961261510849,
      "pose_rmse_dx": 0.06639597564935684,
      "pose_rmse_dy": 0.0629546046257019,
      "pose_rmse_mean": 0.09858223795890808,
      "rmse_dtheta": 0.021042583510279655,
      "rmse_dx": 0.007080666720867157,
      "rmse_dy": 0.004372337367385626,
      "rmse_mean": 0.010831862688064575,
      "rotation_flip": 0.002087682718411088,
      "sparse_tokens": 32121.0,
      "step": 6047,
      "turn_loss": 0.07672230899333954,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2809886638171344,
      "grad_norm": 0.4122149646282196,
      "learning_rate": 5.0171888148368545e-06,
      "loss": 0.1091,
      "mae_dtheta": 0.010089344345033169,
      "mae_dx": 0.0020070888567715883,
      "mae_dy": 0.0015512199606746435,
      "pose_mae_dtheta": 0.0708363801240921,
      "pose_mae_dx": 0.02253427356481552,
      "pose_mae_dy": 0.023386668413877487,
      "pose_rmse_dtheta": 0.21361766755580902,
      "pose_rmse_dx": 0.05964409187436104,
      "pose_rmse_dy": 0.05886358022689819,
      "pose_rmse_mean": 0.11070844531059265,
      "rmse_dtheta": 0.025040285661816597,
      "rmse_dx": 0.006509081926196814,
      "rmse_dy": 0.0034803254529833794,
      "rmse_mean": 0.011676564812660217,
      "rotation_flip": 0.002568053314462304,
      "sparse_tokens": 32073.0,
      "step": 6048,
      "turn_loss": 0.08536890894174576,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.28103512358297716,
      "grad_norm": 0.5809245705604553,
      "learning_rate": 5.015866602934112e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.024225126951932907,
      "mae_dx": 0.013787233270704746,
      "mae_dy": 0.004074187483638525,
      "pose_mae_dtheta": 0.18056192994117737,
      "pose_mae_dx": 0.12033873796463013,
      "pose_mae_dy": 0.05252363532781601,
      "pose_rmse_dtheta": 0.3298887312412262,
      "pose_rmse_dx": 0.28119421005249023,
      "pose_rmse_dy": 0.12213234603404999,
      "pose_rmse_mean": 0.2444050908088684,
      "rmse_dtheta": 0.038866475224494934,
      "rmse_dx": 0.02780582383275032,
      "rmse_dy": 0.008972859010100365,
      "rmse_mean": 0.02521505206823349,
      "rotation_flip": 0.010309278033673763,
      "sparse_tokens": 8146.0,
      "step": 6049,
      "turn_loss": 0.2808709442615509,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 32015.0,
      "epoch": 0.28108158334881994,
      "grad_norm": 0.5537704825401306,
      "learning_rate": 5.014544389921811e-06,
      "loss": 0.1698,
      "mae_dtheta": 0.031117912381887436,
      "mae_dx": 0.011704547330737114,
      "mae_dy": 0.005280002951622009,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5537705421447754,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 144.865966796875,
      "model/head/act_norm_mean": 108.79578993055556,
      "model/head/act_norm_min": 72.59774780273438,
      "model/head/act_over_embed": 74.76548540251082,
      "model/head/grad_frac": 0.1188199520111084,
      "model/head/grad_norm": 0.06579899042844772,
      "model/head/grad_zero_frac": 0.0001595876965438947,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6984986584595959,
      "model/head/update_ratio": 0.001124104717746377,
      "model/head/weight_delta": 8.953757286071777,
      "model/head/weight_delta_rel": 0.1570754200220108,
      "model/head/weight_norm": 58.53457260131836,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4207111597061157,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4207111597061157,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4207111597061157,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2891166477099761,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09465976804494858,
      "model/modality_embedder.encoders.pose/grad_norm": 0.052419792860746384,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016941447975113988,
      "model/modality_embedder.encoders.pose/weight_delta": 2.907593011856079,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09500012546777725,
      "model/modality_embedder.encoders.pose/weight_norm": 30.941741943359375,
      "model/modality_embedder/grad_frac": 0.09465976804494858,
      "model/modality_embedder/grad_norm": 0.052419792860746384,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0016941447975113988,
      "model/modality_embedder/weight_delta": 2.907593011856079,
      "model/modality_embedder/weight_delta_rel": 0.09500012546777725,
      "model/modality_embedder/weight_norm": 30.941741943359375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.5315170288086,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.46878006253006,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.053356170654297,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.12796537715132,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10952920466661453,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06065404787659645,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0021769299637526274,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.285789728164673,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0832955539226532,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.86219596862793,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.87348175048828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.24872484768318,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.500578880310059,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.663950735466667,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.11007430404424667,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06095590814948082,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0020587516482919455,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.8970229625701904,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10035514086484909,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.608190536499023,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.35358428955078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.849041005291006,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.925131797790527,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.763702981370685,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11173059791326523,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.061873115599155426,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002024012850597501,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.123915195465088,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1048952266573906,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.569528579711914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.93961334228516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.750415864999198,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.018353462219238,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.070345585914048,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10612387210130692,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.058768272399902344,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019704762380570173,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.6688501834869385,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09120863676071167,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.824399948120117,
      "model/normalizer/grad_frac": 0.4179338216781616,
      "model/normalizer/grad_norm": 0.23143944144248962,
      "model/normalizer/grad_zero_frac": 0.0001571712055010721,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002949189394712448,
      "model/normalizer/weight_delta": 5.651408672332764,
      "model/normalizer/weight_delta_rel": 0.07278687506914139,
      "model/normalizer/weight_norm": 78.4756088256836,
      "pose_mae_dtheta": 0.24311992526054382,
      "pose_mae_dx": 0.09444938600063324,
      "pose_mae_dy": 0.06592901796102524,
      "pose_rmse_dtheta": 0.42734062671661377,
      "pose_rmse_dx": 0.21210521459579468,
      "pose_rmse_dy": 0.1574622541666031,
      "pose_rmse_mean": 0.26563602685928345,
      "rmse_dtheta": 0.046596452593803406,
      "rmse_dx": 0.02395009808242321,
      "rmse_dy": 0.010422400198876858,
      "rmse_mean": 0.02698965184390545,
      "rotation_flip": 0.00975243840366602,
      "sparse_tokens": 25891.0,
      "step": 6050,
      "turn_loss": 0.2675475776195526,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 19803.0,
      "epoch": 0.2811280431146627,
      "grad_norm": 0.6506975293159485,
      "learning_rate": 5.013222175892411e-06,
      "loss": 0.1633,
      "mae_dtheta": 0.028834505006670952,
      "mae_dx": 0.01162241492420435,
      "mae_dy": 0.0033441483974456787,
      "pose_mae_dtheta": 0.19877637922763824,
      "pose_mae_dx": 0.08991791307926178,
      "pose_mae_dy": 0.048552826046943665,
      "pose_rmse_dtheta": 0.3879130184650421,
      "pose_rmse_dx": 0.21548190712928772,
      "pose_rmse_dy": 0.1047922745347023,
      "pose_rmse_mean": 0.2360624074935913,
      "rmse_dtheta": 0.04611356556415558,
      "rmse_dx": 0.024809347465634346,
      "rmse_dy": 0.0070846411399543285,
      "rmse_mean": 0.026002516970038414,
      "rotation_flip": 0.01154249720275402,
      "sparse_tokens": 15313.0,
      "step": 6051,
      "turn_loss": 0.23659491539001465,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.2811745028805055,
      "grad_norm": 0.6026691794395447,
      "learning_rate": 5.011899960938378e-06,
      "loss": 0.1787,
      "mae_dtheta": 0.03363895043730736,
      "mae_dx": 0.01466025784611702,
      "mae_dy": 0.00843819323927164,
      "pose_mae_dtheta": 0.28230610489845276,
      "pose_mae_dx": 0.1289818286895752,
      "pose_mae_dy": 0.08575621247291565,
      "pose_rmse_dtheta": 0.5064270496368408,
      "pose_rmse_dx": 0.31002745032310486,
      "pose_rmse_dy": 0.20721395313739777,
      "pose_rmse_mean": 0.3412228524684906,
      "rmse_dtheta": 0.05199287831783295,
      "rmse_dx": 0.028896909207105637,
      "rmse_dy": 0.01964867115020752,
      "rmse_mean": 0.03351282328367233,
      "rotation_flip": 0.006745362654328346,
      "sparse_tokens": 12367.0,
      "step": 6052,
      "turn_loss": 0.36731594800949097,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.28122096264634827,
      "grad_norm": 0.4248236119747162,
      "learning_rate": 5.0105777451521745e-06,
      "loss": 0.0867,
      "mae_dtheta": 0.00729054631665349,
      "mae_dx": 0.0013231387129053473,
      "mae_dy": 0.0014999116538092494,
      "pose_mae_dtheta": 0.04553917422890663,
      "pose_mae_dx": 0.015508766286075115,
      "pose_mae_dy": 0.016037771478295326,
      "pose_rmse_dtheta": 0.11548994481563568,
      "pose_rmse_dx": 0.04620892554521561,
      "pose_rmse_dy": 0.0400545708835125,
      "pose_rmse_mean": 0.06725115329027176,
      "rmse_dtheta": 0.019424889236688614,
      "rmse_dx": 0.003719773842021823,
      "rmse_dy": 0.0043435124680399895,
      "rmse_mean": 0.009162725880742073,
      "rotation_flip": 0.002961082849651575,
      "sparse_tokens": 32153.0,
      "step": 6053,
      "turn_loss": 0.06454567611217499,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.28126742241219105,
      "grad_norm": 0.6101483106613159,
      "learning_rate": 5.009255528626263e-06,
      "loss": 0.113,
      "mae_dtheta": 0.008125231601297855,
      "mae_dx": 0.00158593337982893,
      "mae_dy": 0.0002546327013988048,
      "pose_mae_dtheta": 0.058775436133146286,
      "pose_mae_dx": 0.012249189428985119,
      "pose_mae_dy": 0.003514754120260477,
      "pose_rmse_dtheta": 0.2427414357662201,
      "pose_rmse_dx": 0.0292130708694458,
      "pose_rmse_dy": 0.008875375613570213,
      "pose_rmse_mean": 0.09360995888710022,
      "rmse_dtheta": 0.02932148240506649,
      "rmse_dx": 0.0042694248259067535,
      "rmse_dy": 0.0005450992030091584,
      "rmse_mean": 0.011378668248653412,
      "rotation_flip": 0.0013020833721384406,
      "sparse_tokens": 32217.0,
      "step": 6054,
      "turn_loss": 0.0438108965754509,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2813138821780338,
      "grad_norm": 0.7029427886009216,
      "learning_rate": 5.007933311453108e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.011779760010540485,
      "mae_dx": 0.0016903040232136846,
      "mae_dy": 0.003143847920000553,
      "pose_mae_dtheta": 0.08294767141342163,
      "pose_mae_dx": 0.0253159049898386,
      "pose_mae_dy": 0.036688219755887985,
      "pose_rmse_dtheta": 0.2057293802499771,
      "pose_rmse_dx": 0.0706915333867073,
      "pose_rmse_dy": 0.10382384806871414,
      "pose_rmse_mean": 0.12674826383590698,
      "rmse_dtheta": 0.024904964491724968,
      "rmse_dx": 0.004551350604742765,
      "rmse_dy": 0.007655390538275242,
      "rmse_mean": 0.012370569631457329,
      "rotation_flip": 0.006339144427329302,
      "sparse_tokens": 32121.0,
      "step": 6055,
      "turn_loss": 0.10933567583560944,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2813603419438766,
      "grad_norm": 0.43167844414711,
      "learning_rate": 5.006611093725172e-06,
      "loss": 0.1021,
      "mae_dtheta": 0.010741263628005981,
      "mae_dx": 0.0013751989463344216,
      "mae_dy": 0.0022602707613259554,
      "pose_mae_dtheta": 0.07188452780246735,
      "pose_mae_dx": 0.019128989428281784,
      "pose_mae_dy": 0.025569381192326546,
      "pose_rmse_dtheta": 0.20618854463100433,
      "pose_rmse_dx": 0.0429859533905983,
      "pose_rmse_dy": 0.062111906707286835,
      "pose_rmse_mean": 0.10376214236021042,
      "rmse_dtheta": 0.02668071910738945,
      "rmse_dx": 0.0036441271658986807,
      "rmse_dy": 0.005019884556531906,
      "rmse_mean": 0.01178157702088356,
      "rotation_flip": 0.006329114083200693,
      "sparse_tokens": 32105.0,
      "step": 6056,
      "turn_loss": 0.07619531452655792,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.2814068017097194,
      "grad_norm": 0.5323306322097778,
      "learning_rate": 5.00528887553492e-06,
      "loss": 0.1599,
      "mae_dtheta": 0.03704851493239403,
      "mae_dx": 0.01256643421947956,
      "mae_dy": 0.00533220823854208,
      "pose_mae_dtheta": 0.28408128023147583,
      "pose_mae_dx": 0.11606284230947495,
      "pose_mae_dy": 0.05774892494082451,
      "pose_rmse_dtheta": 0.47878190875053406,
      "pose_rmse_dx": 0.23646076023578644,
      "pose_rmse_dy": 0.13587254285812378,
      "pose_rmse_mean": 0.28370508551597595,
      "rmse_dtheta": 0.05432135611772537,
      "rmse_dx": 0.024885065853595734,
      "rmse_dy": 0.01085658185184002,
      "rmse_mean": 0.030021002516150475,
      "rotation_flip": 0.017126545310020447,
      "sparse_tokens": 18261.0,
      "step": 6057,
      "turn_loss": 0.33822840452194214,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.28145326147556216,
      "grad_norm": 0.3702428638935089,
      "learning_rate": 5.003966656974811e-06,
      "loss": 0.128,
      "mae_dtheta": 0.0325746051967144,
      "mae_dx": 0.01664336770772934,
      "mae_dy": 0.005539927631616592,
      "pose_mae_dtheta": 0.2689124345779419,
      "pose_mae_dx": 0.1339646428823471,
      "pose_mae_dy": 0.06553412228822708,
      "pose_rmse_dtheta": 0.4753425717353821,
      "pose_rmse_dx": 0.2793326675891876,
      "pose_rmse_dy": 0.15582673251628876,
      "pose_rmse_mean": 0.3035006821155548,
      "rmse_dtheta": 0.049988508224487305,
      "rmse_dx": 0.029608936980366707,
      "rmse_dy": 0.011720476672053337,
      "rmse_mean": 0.030439307913184166,
      "rotation_flip": 0.014806377701461315,
      "sparse_tokens": 15894.0,
      "step": 6058,
      "turn_loss": 0.2965647876262665,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.28149972124140493,
      "grad_norm": 0.6176571846008301,
      "learning_rate": 5.002644438137313e-06,
      "loss": 0.1265,
      "mae_dtheta": 0.015444342978298664,
      "mae_dx": 0.002429916989058256,
      "mae_dy": 0.003421928733587265,
      "pose_mae_dtheta": 0.11721310764551163,
      "pose_mae_dx": 0.024067798629403114,
      "pose_mae_dy": 0.03173438459634781,
      "pose_rmse_dtheta": 0.31347063183784485,
      "pose_rmse_dx": 0.05825217068195343,
      "pose_rmse_dy": 0.07541093975305557,
      "pose_rmse_mean": 0.14904458820819855,
      "rmse_dtheta": 0.03378073498606682,
      "rmse_dx": 0.008610272780060768,
      "rmse_dy": 0.00879064854234457,
      "rmse_mean": 0.017060553655028343,
      "rotation_flip": 0.005683971103280783,
      "sparse_tokens": 32105.0,
      "step": 6059,
      "turn_loss": 0.1333227902650833,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.2815461810072477,
      "grad_norm": 0.512966513633728,
      "learning_rate": 5.001322219114889e-06,
      "loss": 0.1276,
      "mae_dtheta": 0.026393035426735878,
      "mae_dx": 0.007446296978741884,
      "mae_dy": 0.0030340233352035284,
      "pose_mae_dtheta": 0.2031993716955185,
      "pose_mae_dx": 0.05557114630937576,
      "pose_mae_dy": 0.04382489621639252,
      "pose_rmse_dtheta": 0.3961135447025299,
      "pose_rmse_dx": 0.12049043923616409,
      "pose_rmse_dy": 0.10629912465810776,
      "pose_rmse_mean": 0.20763437449932098,
      "rmse_dtheta": 0.04504597559571266,
      "rmse_dx": 0.016873089596629143,
      "rmse_dy": 0.006006523966789246,
      "rmse_mean": 0.0226418636739254,
      "rotation_flip": 0.00878293626010418,
      "sparse_tokens": 13245.0,
      "step": 6060,
      "turn_loss": 0.2003813534975052,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.2815926407730905,
      "grad_norm": 0.36436963081359863,
      "learning_rate": 5e-06,
      "loss": 0.0951,
      "mae_dtheta": 0.02080552838742733,
      "mae_dx": 0.012492490001022816,
      "mae_dy": 0.0048119197599589825,
      "pose_mae_dtheta": 0.14939771592617035,
      "pose_mae_dx": 0.10379399359226227,
      "pose_mae_dy": 0.0598347969353199,
      "pose_rmse_dtheta": 0.2957410216331482,
      "pose_rmse_dx": 0.23900018632411957,
      "pose_rmse_dy": 0.14437639713287354,
      "pose_rmse_mean": 0.22637253999710083,
      "rmse_dtheta": 0.03632837161421776,
      "rmse_dx": 0.025626299902796745,
      "rmse_dy": 0.010903921909630299,
      "rmse_mean": 0.02428619936108589,
      "rotation_flip": 0.00991735514253378,
      "sparse_tokens": 12833.0,
      "step": 6061,
      "turn_loss": 0.19916127622127533,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.28163910053893326,
      "grad_norm": 1.054319977760315,
      "learning_rate": 4.998677780885112e-06,
      "loss": 0.3032,
      "mae_dtheta": 0.038295213133096695,
      "mae_dx": 0.017588363960385323,
      "mae_dy": 0.0076721408404409885,
      "pose_mae_dtheta": 0.3114539086818695,
      "pose_mae_dx": 0.1523326188325882,
      "pose_mae_dy": 0.08261453360319138,
      "pose_rmse_dtheta": 0.511888861656189,
      "pose_rmse_dx": 0.28405413031578064,
      "pose_rmse_dy": 0.14743351936340332,
      "pose_rmse_mean": 0.31445884704589844,
      "rmse_dtheta": 0.05363285914063454,
      "rmse_dx": 0.029762856662273407,
      "rmse_dy": 0.013095077127218246,
      "rmse_mean": 0.032163601368665695,
      "rotation_flip": 0.01652892492711544,
      "sparse_tokens": 12410.0,
      "step": 6062,
      "turn_loss": 0.3618788719177246,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.28168556030477604,
      "grad_norm": 0.4495652914047241,
      "learning_rate": 4.997355561862688e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.015385745093226433,
      "mae_dx": 0.0024546056520193815,
      "mae_dy": 0.0038803445640951395,
      "pose_mae_dtheta": 0.12057766318321228,
      "pose_mae_dx": 0.031677890568971634,
      "pose_mae_dy": 0.05250411108136177,
      "pose_rmse_dtheta": 0.2933533489704132,
      "pose_rmse_dx": 0.07714085280895233,
      "pose_rmse_dy": 0.1446233093738556,
      "pose_rmse_mean": 0.17170584201812744,
      "rmse_dtheta": 0.03192969784140587,
      "rmse_dx": 0.006330435164272785,
      "rmse_dy": 0.008906502276659012,
      "rmse_mean": 0.015722211450338364,
      "rotation_flip": 0.004741064738482237,
      "sparse_tokens": 32137.0,
      "step": 6063,
      "turn_loss": 0.1425219625234604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.28173202007061887,
      "grad_norm": 0.8534270524978638,
      "learning_rate": 4.9960333430251895e-06,
      "loss": 0.2935,
      "mae_dtheta": 0.0435977540910244,
      "mae_dx": 0.012031897902488708,
      "mae_dy": 0.004440540447831154,
      "pose_mae_dtheta": 0.33914414048194885,
      "pose_mae_dx": 0.10644107311964035,
      "pose_mae_dy": 0.05491959676146507,
      "pose_rmse_dtheta": 0.5416964292526245,
      "pose_rmse_dx": 0.24067087471485138,
      "pose_rmse_dy": 0.1387067437171936,
      "pose_rmse_mean": 0.30702468752861023,
      "rmse_dtheta": 0.061563968658447266,
      "rmse_dx": 0.024223914369940758,
      "rmse_dy": 0.010188302025198936,
      "rmse_mean": 0.03199206292629242,
      "rotation_flip": 0.006657789461314678,
      "sparse_tokens": 12212.0,
      "step": 6064,
      "turn_loss": 0.2960876524448395,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.28177847983646165,
      "grad_norm": 0.4065368175506592,
      "learning_rate": 4.994711124465084e-06,
      "loss": 0.0811,
      "mae_dtheta": 0.005063305608928204,
      "mae_dx": 0.001032183994539082,
      "mae_dy": 0.0005073159118182957,
      "pose_mae_dtheta": 0.034043822437524796,
      "pose_mae_dx": 0.009537971578538418,
      "pose_mae_dy": 0.007609021849930286,
      "pose_rmse_dtheta": 0.15192191302776337,
      "pose_rmse_dx": 0.02742660976946354,
      "pose_rmse_dy": 0.02253047190606594,
      "pose_rmse_mean": 0.06729300320148468,
      "rmse_dtheta": 0.019713863730430603,
      "rmse_dx": 0.003643098520115018,
      "rmse_dy": 0.001122162095271051,
      "rmse_mean": 0.008159708231687546,
      "rotation_flip": 0.0019907099194824696,
      "sparse_tokens": 32105.0,
      "step": 6065,
      "turn_loss": 0.042256779968738556,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.2818249396023044,
      "grad_norm": 0.523753821849823,
      "learning_rate": 4.993388906274829e-06,
      "loss": 0.0862,
      "mae_dtheta": 0.007583472412079573,
      "mae_dx": 0.0018641072092577815,
      "mae_dy": 0.0010338659631088376,
      "pose_mae_dtheta": 0.05634647607803345,
      "pose_mae_dx": 0.016022231429815292,
      "pose_mae_dy": 0.01408489141613245,
      "pose_rmse_dtheta": 0.17895397543907166,
      "pose_rmse_dx": 0.03873790055513382,
      "pose_rmse_dy": 0.04239335283637047,
      "pose_rmse_mean": 0.08669507503509521,
      "rmse_dtheta": 0.022211918607354164,
      "rmse_dx": 0.005032853223383427,
      "rmse_dy": 0.0025640102103352547,
      "rmse_mean": 0.009936260990798473,
      "rotation_flip": 0.001817355747334659,
      "sparse_tokens": 32201.0,
      "step": 6066,
      "turn_loss": 0.06827794760465622,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.2818713993681472,
      "grad_norm": 0.7216621041297913,
      "learning_rate": 4.992066688546895e-06,
      "loss": 0.1634,
      "mae_dtheta": 0.028970301151275635,
      "mae_dx": 0.010538967326283455,
      "mae_dy": 0.004576253704726696,
      "pose_mae_dtheta": 0.21090103685855865,
      "pose_mae_dx": 0.08682125806808472,
      "pose_mae_dy": 0.06920149177312851,
      "pose_rmse_dtheta": 0.421852171421051,
      "pose_rmse_dx": 0.20834137499332428,
      "pose_rmse_dy": 0.14295290410518646,
      "pose_rmse_mean": 0.25771549344062805,
      "rmse_dtheta": 0.046872690320014954,
      "rmse_dx": 0.02426188439130783,
      "rmse_dy": 0.008339221589267254,
      "rmse_mean": 0.02649126574397087,
      "rotation_flip": 0.012012012302875519,
      "sparse_tokens": 18313.0,
      "step": 6067,
      "turn_loss": 0.22598858177661896,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.28191785913399,
      "grad_norm": 0.5801995396614075,
      "learning_rate": 4.990744471373738e-06,
      "loss": 0.1215,
      "mae_dtheta": 0.023306410759687424,
      "mae_dx": 0.003754653036594391,
      "mae_dy": 0.0020765087101608515,
      "pose_mae_dtheta": 0.17458635568618774,
      "pose_mae_dx": 0.029297228902578354,
      "pose_mae_dy": 0.016444936394691467,
      "pose_rmse_dtheta": 0.4322636127471924,
      "pose_rmse_dx": 0.07791882008314133,
      "pose_rmse_dy": 0.041895728558301926,
      "pose_rmse_mean": 0.1840260624885559,
      "rmse_dtheta": 0.04742174968123436,
      "rmse_dx": 0.009601195342838764,
      "rmse_dy": 0.005240107886493206,
      "rmse_mean": 0.02075435221195221,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 6687.0,
      "step": 6068,
      "turn_loss": 0.10389997810125351,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.28196431889983276,
      "grad_norm": 0.47826266288757324,
      "learning_rate": 4.989422254847827e-06,
      "loss": 0.0945,
      "mae_dtheta": 0.012338787317276001,
      "mae_dx": 0.0020923917181789875,
      "mae_dy": 0.0028539220802485943,
      "pose_mae_dtheta": 0.08615803718566895,
      "pose_mae_dx": 0.024929417297244072,
      "pose_mae_dy": 0.03634577617049217,
      "pose_rmse_dtheta": 0.19995145499706268,
      "pose_rmse_dx": 0.07113619893789291,
      "pose_rmse_dy": 0.09212329983711243,
      "pose_rmse_mean": 0.12107031792402267,
      "rmse_dtheta": 0.025271911174058914,
      "rmse_dx": 0.0064718397334218025,
      "rmse_dy": 0.00725133391097188,
      "rmse_mean": 0.012998361140489578,
      "rotation_flip": 0.0061138710007071495,
      "sparse_tokens": 32073.0,
      "step": 6069,
      "turn_loss": 0.10451924800872803,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.28201077866567553,
      "grad_norm": 0.5465521812438965,
      "learning_rate": 4.988100039061624e-06,
      "loss": 0.1237,
      "mae_dtheta": 0.008874270133674145,
      "mae_dx": 0.001444602501578629,
      "mae_dy": 0.0020305365324020386,
      "pose_mae_dtheta": 0.05929548293352127,
      "pose_mae_dx": 0.018476206809282303,
      "pose_mae_dy": 0.02322736755013466,
      "pose_rmse_dtheta": 0.14564505219459534,
      "pose_rmse_dx": 0.05266323313117027,
      "pose_rmse_dy": 0.05969291925430298,
      "pose_rmse_mean": 0.08600040525197983,
      "rmse_dtheta": 0.019980745390057564,
      "rmse_dx": 0.005022408906370401,
      "rmse_dy": 0.004686059430241585,
      "rmse_mean": 0.009896405041217804,
      "rotation_flip": 0.009018567390739918,
      "sparse_tokens": 32057.0,
      "step": 6070,
      "turn_loss": 0.07190357893705368,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.2820572384315183,
      "grad_norm": 0.3910006880760193,
      "learning_rate": 4.98677782410759e-06,
      "loss": 0.0964,
      "mae_dtheta": 0.03286523371934891,
      "mae_dx": 0.008089307695627213,
      "mae_dy": 0.006159408949315548,
      "pose_mae_dtheta": 0.24251706898212433,
      "pose_mae_dx": 0.07038167119026184,
      "pose_mae_dy": 0.08889582008123398,
      "pose_rmse_dtheta": 0.4363432228565216,
      "pose_rmse_dx": 0.16024276614189148,
      "pose_rmse_dy": 0.18554219603538513,
      "pose_rmse_mean": 0.26070940494537354,
      "rmse_dtheta": 0.0495501272380352,
      "rmse_dx": 0.01950160227715969,
      "rmse_dy": 0.010989855043590069,
      "rmse_mean": 0.02668052725493908,
      "rotation_flip": 0.011516314931213856,
      "sparse_tokens": 9712.0,
      "step": 6071,
      "turn_loss": 0.20981258153915405,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.2821036981973611,
      "grad_norm": 0.5812841653823853,
      "learning_rate": 4.985455610078192e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.036644402891397476,
      "mae_dx": 0.00931518990546465,
      "mae_dy": 0.00760423531755805,
      "pose_mae_dtheta": 0.29564064741134644,
      "pose_mae_dx": 0.0901820957660675,
      "pose_mae_dy": 0.09545527398586273,
      "pose_rmse_dtheta": 0.5337437987327576,
      "pose_rmse_dx": 0.20363357663154602,
      "pose_rmse_dy": 0.19242309033870697,
      "pose_rmse_mean": 0.30993351340293884,
      "rmse_dtheta": 0.05607394501566887,
      "rmse_dx": 0.0209721177816391,
      "rmse_dy": 0.013991373591125011,
      "rmse_mean": 0.030345812439918518,
      "rotation_flip": 0.019639935344457626,
      "sparse_tokens": 10250.0,
      "step": 6072,
      "turn_loss": 0.2655550539493561,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.28215015796320386,
      "grad_norm": 0.5585894584655762,
      "learning_rate": 4.984133397065889e-06,
      "loss": 0.1103,
      "mae_dtheta": 0.011861658655107021,
      "mae_dx": 0.0023198651615530252,
      "mae_dy": 0.0030975027475506067,
      "pose_mae_dtheta": 0.07985975593328476,
      "pose_mae_dx": 0.030317256227135658,
      "pose_mae_dy": 0.03573044389486313,
      "pose_rmse_dtheta": 0.17631515860557556,
      "pose_rmse_dx": 0.08296630531549454,
      "pose_rmse_dy": 0.0810512974858284,
      "pose_rmse_mean": 0.1134442538022995,
      "rmse_dtheta": 0.024303223937749863,
      "rmse_dx": 0.007938283495604992,
      "rmse_dy": 0.007293631788343191,
      "rmse_mean": 0.013178380206227303,
      "rotation_flip": 0.005731754004955292,
      "sparse_tokens": 32057.0,
      "step": 6073,
      "turn_loss": 0.10076457262039185,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.28219661772904664,
      "grad_norm": 0.6950752139091492,
      "learning_rate": 4.982811185163146e-06,
      "loss": 0.2005,
      "mae_dtheta": 0.039735931903123856,
      "mae_dx": 0.013075639493763447,
      "mae_dy": 0.004801006056368351,
      "pose_mae_dtheta": 0.30918750166893005,
      "pose_mae_dx": 0.10359855741262436,
      "pose_mae_dy": 0.05968425050377846,
      "pose_rmse_dtheta": 0.5351979732513428,
      "pose_rmse_dx": 0.2283485382795334,
      "pose_rmse_dy": 0.14070501923561096,
      "pose_rmse_mean": 0.30141720175743103,
      "rmse_dtheta": 0.05714011564850807,
      "rmse_dx": 0.025598077103495598,
      "rmse_dy": 0.011829931288957596,
      "rmse_mean": 0.031522706151008606,
      "rotation_flip": 0.013531799428164959,
      "sparse_tokens": 22926.0,
      "step": 6074,
      "turn_loss": 0.3274787366390228,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2822430774948894,
      "grad_norm": 0.6691232919692993,
      "learning_rate": 4.981488974462428e-06,
      "loss": 0.1799,
      "mae_dtheta": 0.008373035117983818,
      "mae_dx": 0.00154830829706043,
      "mae_dy": 0.0027600519824773073,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.669123113155365,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.78604125976562,
      "model/head/act_norm_mean": 112.88668915719697,
      "model/head/act_norm_min": 56.80845260620117,
      "model/head/act_over_embed": 77.57678965066077,
      "model/head/grad_frac": 0.09769638627767563,
      "model/head/grad_norm": 0.06537090986967087,
      "model/head/grad_zero_frac": 0.00019988120766356587,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7030312894570707,
      "model/head/update_ratio": 0.0011167335323989391,
      "model/head/weight_delta": 8.96644401550293,
      "model/head/weight_delta_rel": 0.1572979837656021,
      "model/head/weight_norm": 58.5376091003418,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4207976162433624,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42074139625238616,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42068082094192505,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2891374265476521,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09682805836200714,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06478989124298096,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5348646069004525,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002093939110636711,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9091928005218506,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09505239874124527,
      "model/modality_embedder.encoders.pose/weight_norm": 30.941631317138672,
      "model/modality_embedder/grad_frac": 0.09682805836200714,
      "model/modality_embedder/grad_norm": 0.06478989124298096,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5348646069004525,
      "model/modality_embedder/update_ratio": 0.002093939110636711,
      "model/modality_embedder/weight_delta": 2.9091928005218506,
      "model/modality_embedder/weight_delta_rel": 0.09505239874124527,
      "model/modality_embedder/weight_norm": 30.941631317138672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.95622253417969,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.946884519801188,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.035837173461914,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.45652323627249,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07926992326974869,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05304133892059326,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019036076264455914,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.2915492057800293,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08350543677806854,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.863588333129883,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.8074722290039,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.98492364117364,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.320490837097168,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.16987343875501,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06663024425506592,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04458383843302727,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015056947013363242,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.903651237487793,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10058474540710449,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.610145568847656,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.77381896972656,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.889500160333494,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.512272834777832,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.47871625364796,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0694199874997139,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04645051807165146,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015194168081507087,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.130821943283081,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10512714087963104,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.57128143310547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.44224548339844,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.67521444604778,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.11678409576416,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.70587582891136,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0598105788230896,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.040020640939474106,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.00134184374473989,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.6750619411468506,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09142091870307922,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.82511329650879,
      "model/normalizer/grad_frac": 0.27040573954582214,
      "model/normalizer/grad_norm": 0.18093472719192505,
      "model/normalizer/grad_zero_frac": 0.00021743986872024834,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002305567730218172,
      "model/normalizer/weight_delta": 5.6644182205200195,
      "model/normalizer/weight_delta_rel": 0.07295442372560501,
      "model/normalizer/weight_norm": 78.477294921875,
      "pose_mae_dtheta": 0.056780342012643814,
      "pose_mae_dx": 0.02009476348757744,
      "pose_mae_dy": 0.02629745565354824,
      "pose_rmse_dtheta": 0.13401934504508972,
      "pose_rmse_dx": 0.04681657999753952,
      "pose_rmse_dy": 0.07197974622249603,
      "pose_rmse_mean": 0.08427189290523529,
      "rmse_dtheta": 0.0184092428535223,
      "rmse_dx": 0.0040476624853909016,
      "rmse_dy": 0.006557265296578407,
      "rmse_mean": 0.009671390056610107,
      "rotation_flip": 0.0030592733528465033,
      "sparse_tokens": 32089.0,
      "step": 6075,
      "turn_loss": 0.08256611973047256,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.2822895372607322,
      "grad_norm": 0.4589357376098633,
      "learning_rate": 4.980166765056194e-06,
      "loss": 0.1374,
      "mae_dtheta": 0.03432879224419594,
      "mae_dx": 0.011722488328814507,
      "mae_dy": 0.00637023476883769,
      "pose_mae_dtheta": 0.2456391155719757,
      "pose_mae_dx": 0.1045326367020607,
      "pose_mae_dy": 0.10055975615978241,
      "pose_rmse_dtheta": 0.3933998942375183,
      "pose_rmse_dx": 0.22180601954460144,
      "pose_rmse_dy": 0.19457316398620605,
      "pose_rmse_mean": 0.26992636919021606,
      "rmse_dtheta": 0.048355523496866226,
      "rmse_dx": 0.02497834339737892,
      "rmse_dy": 0.010545846074819565,
      "rmse_mean": 0.027959903702139854,
      "rotation_flip": 0.011075949296355247,
      "sparse_tokens": 12825.0,
      "step": 6076,
      "turn_loss": 0.3452555239200592,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.28233599702657497,
      "grad_norm": 0.6982608437538147,
      "learning_rate": 4.9788445570369106e-06,
      "loss": 0.0819,
      "mae_dtheta": 0.030785132199525833,
      "mae_dx": 0.01148178894072771,
      "mae_dy": 0.008383813314139843,
      "pose_mae_dtheta": 0.224336177110672,
      "pose_mae_dx": 0.11893162131309509,
      "pose_mae_dy": 0.08065148442983627,
      "pose_rmse_dtheta": 0.4339481592178345,
      "pose_rmse_dx": 0.2839149236679077,
      "pose_rmse_dy": 0.1663181483745575,
      "pose_rmse_mean": 0.294727087020874,
      "rmse_dtheta": 0.04815031215548515,
      "rmse_dx": 0.024982251226902008,
      "rmse_dy": 0.017323121428489685,
      "rmse_mean": 0.030151894316077232,
      "rotation_flip": 0.004680186975747347,
      "sparse_tokens": 12067.0,
      "step": 6077,
      "turn_loss": 0.27588126063346863,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.28238245679241775,
      "grad_norm": 0.6136766076087952,
      "learning_rate": 4.9775223504970366e-06,
      "loss": 0.1232,
      "mae_dtheta": 0.016494406387209892,
      "mae_dx": 0.0026163412258028984,
      "mae_dy": 0.00447126105427742,
      "pose_mae_dtheta": 0.11755195260047913,
      "pose_mae_dx": 0.03473350778222084,
      "pose_mae_dy": 0.03662291541695595,
      "pose_rmse_dtheta": 0.27299872040748596,
      "pose_rmse_dx": 0.08162529021501541,
      "pose_rmse_dy": 0.07836345583200455,
      "pose_rmse_mean": 0.14432916045188904,
      "rmse_dtheta": 0.03207440674304962,
      "rmse_dx": 0.006535317283123732,
      "rmse_dy": 0.008757451549172401,
      "rmse_mean": 0.015789059922099113,
      "rotation_flip": 0.004608294926583767,
      "sparse_tokens": 32073.0,
      "step": 6078,
      "turn_loss": 0.1428041011095047,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.2824289165582605,
      "grad_norm": 0.6194085478782654,
      "learning_rate": 4.976200145529039e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.025458412244915962,
      "mae_dx": 0.01078115776181221,
      "mae_dy": 0.004179555922746658,
      "pose_mae_dtheta": 0.18453098833560944,
      "pose_mae_dx": 0.08661293238401413,
      "pose_mae_dy": 0.053295738995075226,
      "pose_rmse_dtheta": 0.3744654953479767,
      "pose_rmse_dx": 0.2109493911266327,
      "pose_rmse_dy": 0.12387248873710632,
      "pose_rmse_mean": 0.2364291399717331,
      "rmse_dtheta": 0.04240326210856438,
      "rmse_dx": 0.023540835827589035,
      "rmse_dy": 0.007848268374800682,
      "rmse_mean": 0.02459745667874813,
      "rotation_flip": 0.017391303554177284,
      "sparse_tokens": 7605.0,
      "step": 6079,
      "turn_loss": 0.23663140833377838,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.2824753763241033,
      "grad_norm": 0.6393589973449707,
      "learning_rate": 4.974877942225375e-06,
      "loss": 0.1435,
      "mae_dtheta": 0.03570834919810295,
      "mae_dx": 0.010038962587714195,
      "mae_dy": 0.003686533309519291,
      "pose_mae_dtheta": 0.288369357585907,
      "pose_mae_dx": 0.07391956448554993,
      "pose_mae_dy": 0.04646807163953781,
      "pose_rmse_dtheta": 0.5250707268714905,
      "pose_rmse_dx": 0.1875634342432022,
      "pose_rmse_dy": 0.11939320713281631,
      "pose_rmse_mean": 0.27734246850013733,
      "rmse_dtheta": 0.055517617613077164,
      "rmse_dx": 0.02198389731347561,
      "rmse_dy": 0.006757762748748064,
      "rmse_mean": 0.028086427599191666,
      "rotation_flip": 0.020408162847161293,
      "sparse_tokens": 6606.0,
      "step": 6080,
      "turn_loss": 0.23749731481075287,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.28252183608994613,
      "grad_norm": 0.4511510133743286,
      "learning_rate": 4.973555740678512e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.042879294604063034,
      "mae_dx": 0.008930951356887817,
      "mae_dy": 0.011954893358051777,
      "pose_mae_dtheta": 0.2806303799152374,
      "pose_mae_dx": 0.07990027219057083,
      "pose_mae_dy": 0.11340971291065216,
      "pose_rmse_dtheta": 0.48677876591682434,
      "pose_rmse_dx": 0.15673410892486572,
      "pose_rmse_dy": 0.18767917156219482,
      "pose_rmse_mean": 0.2770640254020691,
      "rmse_dtheta": 0.06264687329530716,
      "rmse_dx": 0.0193990096449852,
      "rmse_dy": 0.019475122913718224,
      "rmse_mean": 0.03384033590555191,
      "rotation_flip": 0.01595744676887989,
      "sparse_tokens": 3349.0,
      "step": 6081,
      "turn_loss": 0.32861897349357605,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2825682958557889,
      "grad_norm": 0.43968144059181213,
      "learning_rate": 4.9722335409809104e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.009083016775548458,
      "mae_dx": 0.0010320327710360289,
      "mae_dy": 0.001656854641623795,
      "pose_mae_dtheta": 0.06106119230389595,
      "pose_mae_dx": 0.015576968900859356,
      "pose_mae_dy": 0.02249849960207939,
      "pose_rmse_dtheta": 0.16224712133407593,
      "pose_rmse_dx": 0.046693988144397736,
      "pose_rmse_dy": 0.05360284447669983,
      "pose_rmse_mean": 0.08751465380191803,
      "rmse_dtheta": 0.021745625883340836,
      "rmse_dx": 0.0036732580047100782,
      "rmse_dy": 0.0037566402461379766,
      "rmse_mean": 0.009725174866616726,
      "rotation_flip": 0.003684937721118331,
      "sparse_tokens": 32041.0,
      "step": 6082,
      "turn_loss": 0.05368617922067642,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.2826147556216317,
      "grad_norm": 0.5191681385040283,
      "learning_rate": 4.970911343225031e-06,
      "loss": 0.1377,
      "mae_dtheta": 0.027334433048963547,
      "mae_dx": 0.008913242258131504,
      "mae_dy": 0.006283304188400507,
      "pose_mae_dtheta": 0.19104377925395966,
      "pose_mae_dx": 0.08625005185604095,
      "pose_mae_dy": 0.09003738313913345,
      "pose_rmse_dtheta": 0.3365667462348938,
      "pose_rmse_dx": 0.19026412069797516,
      "pose_rmse_dy": 0.16450291872024536,
      "pose_rmse_mean": 0.23044459521770477,
      "rmse_dtheta": 0.04130057245492935,
      "rmse_dx": 0.020232809707522392,
      "rmse_dy": 0.009826519526541233,
      "rmse_mean": 0.02378663420677185,
      "rotation_flip": 0.01743461936712265,
      "sparse_tokens": 15804.0,
      "step": 6083,
      "turn_loss": 0.24787303805351257,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 19479.0,
      "epoch": 0.28266121538747446,
      "grad_norm": 0.6102998852729797,
      "learning_rate": 4.969589147503339e-06,
      "loss": 0.14,
      "mae_dtheta": 0.033993273973464966,
      "mae_dx": 0.015346414409577847,
      "mae_dy": 0.006825139746069908,
      "pose_mae_dtheta": 0.2687416076660156,
      "pose_mae_dx": 0.1174325942993164,
      "pose_mae_dy": 0.09550835192203522,
      "pose_rmse_dtheta": 0.43624213337898254,
      "pose_rmse_dx": 0.22755897045135498,
      "pose_rmse_dy": 0.20398607850074768,
      "pose_rmse_mean": 0.2892623841762543,
      "rmse_dtheta": 0.04853712394833565,
      "rmse_dx": 0.0285942442715168,
      "rmse_dy": 0.01147354207932949,
      "rmse_mean": 0.029534971341490746,
      "rotation_flip": 0.018104366958141327,
      "sparse_tokens": 16552.0,
      "step": 6084,
      "turn_loss": 0.2749954164028168,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.28270767515331724,
      "grad_norm": 0.46568262577056885,
      "learning_rate": 4.9682669539082914e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.010760286822915077,
      "mae_dx": 0.001437510596588254,
      "mae_dy": 0.002187250182032585,
      "pose_mae_dtheta": 0.06774897873401642,
      "pose_mae_dx": 0.019706109538674355,
      "pose_mae_dy": 0.027432354167103767,
      "pose_rmse_dtheta": 0.15414024889469147,
      "pose_rmse_dx": 0.04685816913843155,
      "pose_rmse_dy": 0.060837555676698685,
      "pose_rmse_mean": 0.08727866411209106,
      "rmse_dtheta": 0.0233047716319561,
      "rmse_dx": 0.003981546498835087,
      "rmse_dy": 0.004644468426704407,
      "rmse_mean": 0.010643595829606056,
      "rotation_flip": 0.008006405085325241,
      "sparse_tokens": 32073.0,
      "step": 6085,
      "turn_loss": 0.09125197678804398,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.28275413491916,
      "grad_norm": 0.49087586998939514,
      "learning_rate": 4.966944762532356e-06,
      "loss": 0.1584,
      "mae_dtheta": 0.04063234478235245,
      "mae_dx": 0.006746234372258186,
      "mae_dy": 0.0031339593697339296,
      "pose_mae_dtheta": 0.3004564642906189,
      "pose_mae_dx": 0.05557630583643913,
      "pose_mae_dy": 0.029648780822753906,
      "pose_rmse_dtheta": 0.5319710373878479,
      "pose_rmse_dx": 0.11835317313671112,
      "pose_rmse_dy": 0.07770996540784836,
      "pose_rmse_mean": 0.24267807602882385,
      "rmse_dtheta": 0.06064448133111,
      "rmse_dx": 0.015812871977686882,
      "rmse_dy": 0.006693869363516569,
      "rmse_mean": 0.027717074379324913,
      "rotation_flip": 0.019200000911951065,
      "sparse_tokens": 10106.0,
      "step": 6086,
      "turn_loss": 0.24604378640651703,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2828005946850028,
      "grad_norm": 0.3928903639316559,
      "learning_rate": 4.965622573467988e-06,
      "loss": 0.0724,
      "mae_dtheta": 0.005921009462326765,
      "mae_dx": 0.0011955859372392297,
      "mae_dy": 0.0007741018780507147,
      "pose_mae_dtheta": 0.04297419264912605,
      "pose_mae_dx": 0.01091503445059061,
      "pose_mae_dy": 0.01312844268977642,
      "pose_rmse_dtheta": 0.14461737871170044,
      "pose_rmse_dx": 0.027543457224965096,
      "pose_rmse_dy": 0.03483492136001587,
      "pose_rmse_mean": 0.06899859011173248,
      "rmse_dtheta": 0.018664978444576263,
      "rmse_dx": 0.0037992368452250957,
      "rmse_dy": 0.0016267865430563688,
      "rmse_mean": 0.008030334487557411,
      "rotation_flip": 0.0004759638395626098,
      "sparse_tokens": 32169.0,
      "step": 6087,
      "turn_loss": 0.037954047322273254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.28284705445084557,
      "grad_norm": 0.475534051656723,
      "learning_rate": 4.964300386807653e-06,
      "loss": 0.0738,
      "mae_dtheta": 0.00899234414100647,
      "mae_dx": 0.0017443271353840828,
      "mae_dy": 0.002976725110784173,
      "pose_mae_dtheta": 0.058388128876686096,
      "pose_mae_dx": 0.022494427859783173,
      "pose_mae_dy": 0.02764388546347618,
      "pose_rmse_dtheta": 0.13500548899173737,
      "pose_rmse_dx": 0.06104052811861038,
      "pose_rmse_dy": 0.06632620841264725,
      "pose_rmse_mean": 0.08745741099119186,
      "rmse_dtheta": 0.01972024515271187,
      "rmse_dx": 0.004661617800593376,
      "rmse_dy": 0.006397526245564222,
      "rmse_mean": 0.010259796865284443,
      "rotation_flip": 0.0020833334419876337,
      "sparse_tokens": 32057.0,
      "step": 6088,
      "turn_loss": 0.07182178646326065,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.28289351421668835,
      "grad_norm": 0.4313717186450958,
      "learning_rate": 4.962978202643812e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.00893915630877018,
      "mae_dx": 0.0012412751093506813,
      "mae_dy": 0.0016396191203966737,
      "pose_mae_dtheta": 0.05910608172416687,
      "pose_mae_dx": 0.01744985021650791,
      "pose_mae_dy": 0.020989328622817993,
      "pose_rmse_dtheta": 0.17790274322032928,
      "pose_rmse_dx": 0.04366372153162956,
      "pose_rmse_dy": 0.05188937485218048,
      "pose_rmse_mean": 0.09115195274353027,
      "rmse_dtheta": 0.022066891193389893,
      "rmse_dx": 0.0036214697174727917,
      "rmse_dy": 0.0037687604781240225,
      "rmse_mean": 0.00981904100626707,
      "rotation_flip": 0.004116920754313469,
      "sparse_tokens": 32121.0,
      "step": 6089,
      "turn_loss": 0.06902205944061279,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2829399739825311,
      "grad_norm": 0.6857184767723083,
      "learning_rate": 4.961656021068925e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.012941218912601471,
      "mae_dx": 0.0022935380693525076,
      "mae_dy": 0.0034587178379297256,
      "pose_mae_dtheta": 0.07790829986333847,
      "pose_mae_dx": 0.026780299842357635,
      "pose_mae_dy": 0.032669421285390854,
      "pose_rmse_dtheta": 0.19362443685531616,
      "pose_rmse_dx": 0.07190262526273727,
      "pose_rmse_dy": 0.06796745955944061,
      "pose_rmse_mean": 0.11116485297679901,
      "rmse_dtheta": 0.026711435988545418,
      "rmse_dx": 0.006550980731844902,
      "rmse_dy": 0.00830824114382267,
      "rmse_mean": 0.013856885954737663,
      "rotation_flip": 0.004701141733676195,
      "sparse_tokens": 32105.0,
      "step": 6090,
      "turn_loss": 0.1136837974190712,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2829864337483739,
      "grad_norm": 0.7198988199234009,
      "learning_rate": 4.960333842175453e-06,
      "loss": 0.172,
      "mae_dtheta": 0.010228578001260757,
      "mae_dx": 0.001336031244136393,
      "mae_dy": 0.0018992131808772683,
      "pose_mae_dtheta": 0.07058737426996231,
      "pose_mae_dx": 0.018706655129790306,
      "pose_mae_dy": 0.02456577867269516,
      "pose_rmse_dtheta": 0.21007977426052094,
      "pose_rmse_dx": 0.04923516884446144,
      "pose_rmse_dy": 0.06787726283073425,
      "pose_rmse_mean": 0.10906407237052917,
      "rmse_dtheta": 0.02592913620173931,
      "rmse_dx": 0.004116159398108721,
      "rmse_dy": 0.004120127763599157,
      "rmse_mean": 0.011388475075364113,
      "rotation_flip": 0.003811944043263793,
      "sparse_tokens": 32105.0,
      "step": 6091,
      "turn_loss": 0.06995311379432678,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2830328935142167,
      "grad_norm": 0.42034921050071716,
      "learning_rate": 4.959011666055856e-06,
      "loss": 0.0853,
      "mae_dtheta": 0.00787966139614582,
      "mae_dx": 0.001355266897007823,
      "mae_dy": 0.001731538912281394,
      "pose_mae_dtheta": 0.056224480271339417,
      "pose_mae_dx": 0.015397445298731327,
      "pose_mae_dy": 0.01953916624188423,
      "pose_rmse_dtheta": 0.17975661158561707,
      "pose_rmse_dx": 0.042368512600660324,
      "pose_rmse_dy": 0.0482768639922142,
      "pose_rmse_mean": 0.09013399481773376,
      "rmse_dtheta": 0.020022954791784286,
      "rmse_dx": 0.004911520052701235,
      "rmse_dy": 0.0042854794301092625,
      "rmse_mean": 0.009739984758198261,
      "rotation_flip": 0.004703668877482414,
      "sparse_tokens": 32057.0,
      "step": 6092,
      "turn_loss": 0.06051870808005333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.28307935328005945,
      "grad_norm": 0.3370048999786377,
      "learning_rate": 4.957689492802595e-06,
      "loss": 0.0751,
      "mae_dtheta": 0.04236123710870743,
      "mae_dx": 0.012645077891647816,
      "mae_dy": 0.0026350379921495914,
      "pose_mae_dtheta": 0.33917370438575745,
      "pose_mae_dx": 0.09984023869037628,
      "pose_mae_dy": 0.03261386975646019,
      "pose_rmse_dtheta": 0.6037417054176331,
      "pose_rmse_dx": 0.2579307556152344,
      "pose_rmse_dy": 0.08352205157279968,
      "pose_rmse_mean": 0.31506484746932983,
      "rmse_dtheta": 0.06421639770269394,
      "rmse_dx": 0.026974566280841827,
      "rmse_dy": 0.005031355656683445,
      "rmse_mean": 0.032074108719825745,
      "rotation_flip": 0.011834319680929184,
      "sparse_tokens": 6719.0,
      "step": 6093,
      "turn_loss": 0.22448404133319855,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.28312581304590223,
      "grad_norm": 0.46460503339767456,
      "learning_rate": 4.956367322508131e-06,
      "loss": 0.0729,
      "mae_dtheta": 0.007653451524674892,
      "mae_dx": 0.0013744495809078217,
      "mae_dy": 0.0011252515250816941,
      "pose_mae_dtheta": 0.05633426457643509,
      "pose_mae_dx": 0.012084627524018288,
      "pose_mae_dy": 0.015085500665009022,
      "pose_rmse_dtheta": 0.19476298987865448,
      "pose_rmse_dx": 0.036613110452890396,
      "pose_rmse_dy": 0.054848652333021164,
      "pose_rmse_mean": 0.09540825337171555,
      "rmse_dtheta": 0.023749740794301033,
      "rmse_dx": 0.004739404655992985,
      "rmse_dy": 0.0038447172846645117,
      "rmse_mean": 0.010777954012155533,
      "rotation_flip": 0.004050632938742638,
      "sparse_tokens": 32153.0,
      "step": 6094,
      "turn_loss": 0.0537627674639225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.283172272811745,
      "grad_norm": 0.3738698363304138,
      "learning_rate": 4.9550451552649235e-06,
      "loss": 0.0797,
      "mae_dtheta": 0.007312298286706209,
      "mae_dx": 0.0017838024068623781,
      "mae_dy": 0.0015741762472316623,
      "pose_mae_dtheta": 0.04158664867281914,
      "pose_mae_dx": 0.018623512238264084,
      "pose_mae_dy": 0.01664210669696331,
      "pose_rmse_dtheta": 0.09355555474758148,
      "pose_rmse_dx": 0.0545400008559227,
      "pose_rmse_dy": 0.03896115720272064,
      "pose_rmse_mean": 0.06235223636031151,
      "rmse_dtheta": 0.016951723024249077,
      "rmse_dx": 0.005863578990101814,
      "rmse_dy": 0.0035892718005925417,
      "rmse_mean": 0.008801525458693504,
      "rotation_flip": 0.00479233218356967,
      "sparse_tokens": 32153.0,
      "step": 6095,
      "turn_loss": 0.059760257601737976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.2832187325775878,
      "grad_norm": 0.4513298273086548,
      "learning_rate": 4.953722991165433e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.030173268169164658,
      "mae_dx": 0.010823960416018963,
      "mae_dy": 0.003997712396085262,
      "pose_mae_dtheta": 0.2493453323841095,
      "pose_mae_dx": 0.08325080573558807,
      "pose_mae_dy": 0.05371655151247978,
      "pose_rmse_dtheta": 0.45045095682144165,
      "pose_rmse_dx": 0.19921499490737915,
      "pose_rmse_dy": 0.1207323893904686,
      "pose_rmse_mean": 0.25679945945739746,
      "rmse_dtheta": 0.0489744208753109,
      "rmse_dx": 0.02304256334900856,
      "rmse_dy": 0.007846868596971035,
      "rmse_mean": 0.02662128582596779,
      "rotation_flip": 0.0054869684390723705,
      "sparse_tokens": 12825.0,
      "step": 6096,
      "turn_loss": 0.2181500941514969,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.2832651923434306,
      "grad_norm": 0.3814721405506134,
      "learning_rate": 4.952400830302117e-06,
      "loss": 0.0833,
      "mae_dtheta": 0.032545603811740875,
      "mae_dx": 0.0065225218422710896,
      "mae_dy": 0.003662661649286747,
      "pose_mae_dtheta": 0.261138916015625,
      "pose_mae_dx": 0.053680285811424255,
      "pose_mae_dy": 0.029560884460806847,
      "pose_rmse_dtheta": 0.4639855623245239,
      "pose_rmse_dx": 0.17898818850517273,
      "pose_rmse_dy": 0.08344945311546326,
      "pose_rmse_mean": 0.24214109778404236,
      "rmse_dtheta": 0.05117151513695717,
      "rmse_dx": 0.017689289525151253,
      "rmse_dy": 0.011112736538052559,
      "rmse_mean": 0.026657847687602043,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 6133.0,
      "step": 6097,
      "turn_loss": 0.23967619240283966,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.2833116521092734,
      "grad_norm": 0.7043960690498352,
      "learning_rate": 4.951078672767439e-06,
      "loss": 0.1388,
      "mae_dtheta": 0.03049437329173088,
      "mae_dx": 0.018125055357813835,
      "mae_dy": 0.0041317446157336235,
      "pose_mae_dtheta": 0.15385515987873077,
      "pose_mae_dx": 0.15698319673538208,
      "pose_mae_dy": 0.03774420544505119,
      "pose_rmse_dtheta": 0.2405659407377243,
      "pose_rmse_dx": 0.3076888918876648,
      "pose_rmse_dy": 0.07651836425065994,
      "pose_rmse_mean": 0.2082577347755432,
      "rmse_dtheta": 0.0437488816678524,
      "rmse_dx": 0.03176022693514824,
      "rmse_dy": 0.0070390342734754086,
      "rmse_mean": 0.027516048401594162,
      "rotation_flip": 0.01785714365541935,
      "sparse_tokens": 2671.0,
      "step": 6098,
      "turn_loss": 0.26254701614379883,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.28335811187511617,
      "grad_norm": 0.430830717086792,
      "learning_rate": 4.949756518653853e-06,
      "loss": 0.0831,
      "mae_dtheta": 0.01293128915131092,
      "mae_dx": 0.0025747851468622684,
      "mae_dy": 0.003613203763961792,
      "pose_mae_dtheta": 0.09183447808027267,
      "pose_mae_dx": 0.031080212444067,
      "pose_mae_dy": 0.03201867267489433,
      "pose_rmse_dtheta": 0.21469727158546448,
      "pose_rmse_dx": 0.09112731367349625,
      "pose_rmse_dy": 0.07820677012205124,
      "pose_rmse_mean": 0.12801045179367065,
      "rmse_dtheta": 0.0275187436491251,
      "rmse_dx": 0.007349382620304823,
      "rmse_dy": 0.008637894876301289,
      "rmse_mean": 0.014502006582915783,
      "rotation_flip": 0.007829977199435234,
      "sparse_tokens": 32121.0,
      "step": 6099,
      "turn_loss": 0.1182354986667633,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.28340457164095895,
      "grad_norm": 0.640930712223053,
      "learning_rate": 4.948434368053821e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.011991330422461033,
      "mae_dx": 0.0012899328721687198,
      "mae_dy": 0.002278571482747793,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6409305930137634,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.39659118652344,
      "model/head/act_norm_mean": 108.76739070391415,
      "model/head/act_norm_min": 64.41700744628906,
      "model/head/act_over_embed": 74.7459691880851,
      "model/head/grad_frac": 0.09252551198005676,
      "model/head/grad_norm": 0.0593024305999279,
      "model/head/grad_zero_frac": 0.00014848318824078888,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7032828282828283,
      "model/head/update_ratio": 0.0010130202863365412,
      "model/head/weight_delta": 8.979384422302246,
      "model/head/weight_delta_rel": 0.15752500295639038,
      "model/head/weight_norm": 58.54022216796875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42080584168434143,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42073462991153493,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4206376373767853,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2891327766548717,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08171937614679337,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05237644910812378,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.534298996040724,
      "model/modality_embedder.encoders.pose/update_ratio": 0.00169272196944803,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9107067584991455,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09510186314582825,
      "model/modality_embedder.encoders.pose/weight_norm": 30.9421443939209,
      "model/modality_embedder/grad_frac": 0.08171937614679337,
      "model/modality_embedder/grad_norm": 0.05237644910812378,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.534298996040724,
      "model/modality_embedder/update_ratio": 0.00169272196944803,
      "model/modality_embedder/weight_delta": 2.9107067584991455,
      "model/modality_embedder/weight_delta_rel": 0.09510186314582825,
      "model/modality_embedder/weight_norm": 30.9421443939209,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.64795684814453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.492123617123617,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.013840675354004,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.144007286413814,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07269677519798279,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04659358784556389,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016721328720450401,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.296720266342163,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08369386941194534,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.864763259887695,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.52091979980469,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.49309814413981,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.11536693572998,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.83188635265051,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07604292035102844,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.048738233745098114,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016459126491099596,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.9103305339813232,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10081612318754196,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.611677169799805,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.76162719726562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.343557098765434,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 11.927912712097168,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.10353907053892,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07667931169271469,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04914611577987671,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016075195744633675,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.1383168697357178,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10537880659103394,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.57263946533203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.65050506591797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.120332792207794,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.857129096984863,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.324555961508633,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07798970490694046,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.049985989928245544,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016758855199441314,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.681121349334717,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09162800759077072,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.826614379882812,
      "model/normalizer/grad_frac": 0.2801671326160431,
      "model/normalizer/grad_norm": 0.17956769466400146,
      "model/normalizer/grad_zero_frac": 0.0001394451392116025,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002288095187395811,
      "model/normalizer/weight_delta": 5.6775431632995605,
      "model/normalizer/weight_delta_rel": 0.07312346994876862,
      "model/normalizer/weight_norm": 78.47911834716797,
      "pose_mae_dtheta": 0.08380533754825592,
      "pose_mae_dx": 0.0198991559445858,
      "pose_mae_dy": 0.0333397276699543,
      "pose_rmse_dtheta": 0.2269253432750702,
      "pose_rmse_dx": 0.044120121747255325,
      "pose_rmse_dy": 0.08826915919780731,
      "pose_rmse_mean": 0.11977154016494751,
      "rmse_dtheta": 0.026536105200648308,
      "rmse_dx": 0.0039761909283697605,
      "rmse_dy": 0.004663056693971157,
      "rmse_mean": 0.01172511838376522,
      "rotation_flip": 0.005549389403313398,
      "sparse_tokens": 32089.0,
      "step": 6100,
      "turn_loss": 0.08875176310539246,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.2834510314068017,
      "grad_norm": 0.35321807861328125,
      "learning_rate": 4.947112221059803e-06,
      "loss": 0.0858,
      "mae_dtheta": 0.009250867180526257,
      "mae_dx": 0.0015209998236969113,
      "mae_dy": 0.0002498557441867888,
      "pose_mae_dtheta": 0.06588026136159897,
      "pose_mae_dx": 0.012771247886121273,
      "pose_mae_dy": 0.0034741386771202087,
      "pose_rmse_dtheta": 0.27741751074790955,
      "pose_rmse_dx": 0.03197994455695152,
      "pose_rmse_dy": 0.007070457562804222,
      "pose_rmse_mean": 0.10548930615186691,
      "rmse_dtheta": 0.03245508670806885,
      "rmse_dx": 0.004349144175648689,
      "rmse_dy": 0.0004967260174453259,
      "rmse_mean": 0.012433651834726334,
      "rotation_flip": 0.0038684720639139414,
      "sparse_tokens": 32217.0,
      "step": 6101,
      "turn_loss": 0.048395249992609024,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.2834974911726445,
      "grad_norm": 0.3496687710285187,
      "learning_rate": 4.945790077764255e-06,
      "loss": 0.1369,
      "mae_dtheta": 0.02872907929122448,
      "mae_dx": 0.010408775880932808,
      "mae_dy": 0.007693550083786249,
      "pose_mae_dtheta": 0.20777301490306854,
      "pose_mae_dx": 0.06223689019680023,
      "pose_mae_dy": 0.0665302649140358,
      "pose_rmse_dtheta": 0.3163056969642639,
      "pose_rmse_dx": 0.11556647717952728,
      "pose_rmse_dy": 0.14860917627811432,
      "pose_rmse_mean": 0.1934937834739685,
      "rmse_dtheta": 0.04149037227034569,
      "rmse_dx": 0.021539656445384026,
      "rmse_dy": 0.013344833627343178,
      "rmse_mean": 0.025458287447690964,
      "rotation_flip": 0.023255813866853714,
      "sparse_tokens": 2681.0,
      "step": 6102,
      "turn_loss": 0.23148298263549805,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.2835439509384873,
      "grad_norm": 0.49173417687416077,
      "learning_rate": 4.944467938259636e-06,
      "loss": 0.0925,
      "mae_dtheta": 0.025281965732574463,
      "mae_dx": 0.011087201535701752,
      "mae_dy": 0.0024871770292520523,
      "pose_mae_dtheta": 0.20221607387065887,
      "pose_mae_dx": 0.0854150652885437,
      "pose_mae_dy": 0.039282672107219696,
      "pose_rmse_dtheta": 0.41220882534980774,
      "pose_rmse_dx": 0.23360158503055573,
      "pose_rmse_dy": 0.10124383121728897,
      "pose_rmse_mean": 0.2490181028842926,
      "rmse_dtheta": 0.04419730603694916,
      "rmse_dx": 0.025079289451241493,
      "rmse_dy": 0.005196600686758757,
      "rmse_mean": 0.02482439950108528,
      "rotation_flip": 0.00872093066573143,
      "sparse_tokens": 17072.0,
      "step": 6103,
      "turn_loss": 0.19737210869789124,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.28359041070433005,
      "grad_norm": 0.42058807611465454,
      "learning_rate": 4.943145802638403e-06,
      "loss": 0.0857,
      "mae_dtheta": 0.007041914854198694,
      "mae_dx": 0.001662126975134015,
      "mae_dy": 0.0023790220730006695,
      "pose_mae_dtheta": 0.047817930579185486,
      "pose_mae_dx": 0.020667271688580513,
      "pose_mae_dy": 0.023229524493217468,
      "pose_rmse_dtheta": 0.10652848333120346,
      "pose_rmse_dx": 0.0574011504650116,
      "pose_rmse_dy": 0.05986042320728302,
      "pose_rmse_mean": 0.07459668815135956,
      "rmse_dtheta": 0.015131286345422268,
      "rmse_dx": 0.00455267122015357,
      "rmse_dy": 0.005143565591424704,
      "rmse_mean": 0.008275841362774372,
      "rotation_flip": 0.002289377385750413,
      "sparse_tokens": 32073.0,
      "step": 6104,
      "turn_loss": 0.06383826583623886,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.28363687047017283,
      "grad_norm": 0.48853057622909546,
      "learning_rate": 4.941823670993016e-06,
      "loss": 0.104,
      "mae_dtheta": 0.010118899866938591,
      "mae_dx": 0.0014863474061712623,
      "mae_dy": 0.0011386893456801772,
      "pose_mae_dtheta": 0.0708068385720253,
      "pose_mae_dx": 0.01531451940536499,
      "pose_mae_dy": 0.014580483548343182,
      "pose_rmse_dtheta": 0.2243824005126953,
      "pose_rmse_dx": 0.0370851568877697,
      "pose_rmse_dy": 0.03719842806458473,
      "pose_rmse_mean": 0.09955532848834991,
      "rmse_dtheta": 0.027714554220438004,
      "rmse_dx": 0.004360722377896309,
      "rmse_dy": 0.0027828386519104242,
      "rmse_mean": 0.011619373224675655,
      "rotation_flip": 0.0017559262923896313,
      "sparse_tokens": 32185.0,
      "step": 6105,
      "turn_loss": 0.06568297743797302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.2836833302360156,
      "grad_norm": 1.3595646619796753,
      "learning_rate": 4.940501543415929e-06,
      "loss": 0.1897,
      "mae_dtheta": 0.03568311780691147,
      "mae_dx": 0.01439810823649168,
      "mae_dy": 0.0037929592654109,
      "pose_mae_dtheta": 0.27842843532562256,
      "pose_mae_dx": 0.10365360230207443,
      "pose_mae_dy": 0.0475713349878788,
      "pose_rmse_dtheta": 0.5111019015312195,
      "pose_rmse_dx": 0.2507602572441101,
      "pose_rmse_dy": 0.11906702071428299,
      "pose_rmse_mean": 0.293643057346344,
      "rmse_dtheta": 0.05342274159193039,
      "rmse_dx": 0.028591778129339218,
      "rmse_dy": 0.006626637652516365,
      "rmse_mean": 0.02954705059528351,
      "rotation_flip": 0.014331210404634476,
      "sparse_tokens": 10623.0,
      "step": 6106,
      "turn_loss": 0.2554129660129547,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.2837297900018584,
      "grad_norm": 1.0263946056365967,
      "learning_rate": 4.939179419999603e-06,
      "loss": 0.2394,
      "mae_dtheta": 0.02424314245581627,
      "mae_dx": 0.011633502319455147,
      "mae_dy": 0.004236004780977964,
      "pose_mae_dtheta": 0.19459079205989838,
      "pose_mae_dx": 0.10195490717887878,
      "pose_mae_dy": 0.04352449253201485,
      "pose_rmse_dtheta": 0.36716097593307495,
      "pose_rmse_dx": 0.23354315757751465,
      "pose_rmse_dy": 0.08060446381568909,
      "pose_rmse_mean": 0.2271028757095337,
      "rmse_dtheta": 0.039150260388851166,
      "rmse_dx": 0.02436899021267891,
      "rmse_dy": 0.007258825935423374,
      "rmse_mean": 0.023592693731188774,
      "rotation_flip": 0.010940918698906898,
      "sparse_tokens": 9395.0,
      "step": 6107,
      "turn_loss": 0.2121061384677887,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.28377624976770116,
      "grad_norm": 0.5571313500404358,
      "learning_rate": 4.937857300836492e-06,
      "loss": 0.1301,
      "mae_dtheta": 0.009755704551935196,
      "mae_dx": 0.00205259770154953,
      "mae_dy": 0.0019635085482150316,
      "pose_mae_dtheta": 0.06865791231393814,
      "pose_mae_dx": 0.021406490355730057,
      "pose_mae_dy": 0.024465901777148247,
      "pose_rmse_dtheta": 0.18017782270908356,
      "pose_rmse_dx": 0.05885709077119827,
      "pose_rmse_dy": 0.06636808812618256,
      "pose_rmse_mean": 0.10180100053548813,
      "rmse_dtheta": 0.02379513345658779,
      "rmse_dx": 0.006601436994969845,
      "rmse_dy": 0.006439839955419302,
      "rmse_mean": 0.012278802692890167,
      "rotation_flip": 0.001439539366401732,
      "sparse_tokens": 32121.0,
      "step": 6108,
      "turn_loss": 0.08754745870828629,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.28382270953354394,
      "grad_norm": 0.528329074382782,
      "learning_rate": 4.936535186019053e-06,
      "loss": 0.1362,
      "mae_dtheta": 0.012452337890863419,
      "mae_dx": 0.0023338915780186653,
      "mae_dy": 0.004063040018081665,
      "pose_mae_dtheta": 0.07834023237228394,
      "pose_mae_dx": 0.0287646297365427,
      "pose_mae_dy": 0.03673895075917244,
      "pose_rmse_dtheta": 0.15746232867240906,
      "pose_rmse_dx": 0.06391727179288864,
      "pose_rmse_dy": 0.07087776809930801,
      "pose_rmse_mean": 0.0974191278219223,
      "rmse_dtheta": 0.02261967398226261,
      "rmse_dx": 0.006291243247687817,
      "rmse_dy": 0.007719597313553095,
      "rmse_mean": 0.012210171669721603,
      "rotation_flip": 0.009567901492118835,
      "sparse_tokens": 32121.0,
      "step": 6109,
      "turn_loss": 0.12004464864730835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.2838691692993867,
      "grad_norm": 0.3972712457180023,
      "learning_rate": 4.9352130756397435e-06,
      "loss": 0.1171,
      "mae_dtheta": 0.033817339688539505,
      "mae_dx": 0.014480581507086754,
      "mae_dy": 0.003293366637080908,
      "pose_mae_dtheta": 0.24380549788475037,
      "pose_mae_dx": 0.11605372279882431,
      "pose_mae_dy": 0.03567440062761307,
      "pose_rmse_dtheta": 0.48067209124565125,
      "pose_rmse_dx": 0.2609062194824219,
      "pose_rmse_dy": 0.08066537976264954,
      "pose_rmse_mean": 0.2740812301635742,
      "rmse_dtheta": 0.05515127629041672,
      "rmse_dx": 0.027086764574050903,
      "rmse_dy": 0.009281250648200512,
      "rmse_mean": 0.030506430193781853,
      "rotation_flip": 0.008474576286971569,
      "sparse_tokens": 7457.0,
      "step": 6110,
      "turn_loss": 0.278443843126297,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2839156290652295,
      "grad_norm": 0.4768814444541931,
      "learning_rate": 4.933890969791018e-06,
      "loss": 0.1114,
      "mae_dtheta": 0.009936567395925522,
      "mae_dx": 0.0019832258112728596,
      "mae_dy": 0.003674677573144436,
      "pose_mae_dtheta": 0.06474007666110992,
      "pose_mae_dx": 0.028090015053749084,
      "pose_mae_dy": 0.03451869264245033,
      "pose_rmse_dtheta": 0.12558935582637787,
      "pose_rmse_dx": 0.06936509907245636,
      "pose_rmse_dy": 0.07565711438655853,
      "pose_rmse_mean": 0.09020386636257172,
      "rmse_dtheta": 0.019118381664156914,
      "rmse_dx": 0.0047846101224422455,
      "rmse_dy": 0.007928997278213501,
      "rmse_mean": 0.010610662400722504,
      "rotation_flip": 0.002758620772510767,
      "sparse_tokens": 32137.0,
      "step": 6111,
      "turn_loss": 0.10440675914287567,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.28396208883107227,
      "grad_norm": 0.34994858503341675,
      "learning_rate": 4.93256886856533e-06,
      "loss": 0.0923,
      "mae_dtheta": 0.010179387405514717,
      "mae_dx": 0.001757596037350595,
      "mae_dy": 0.0027104190085083246,
      "pose_mae_dtheta": 0.07292217761278152,
      "pose_mae_dx": 0.020893016830086708,
      "pose_mae_dy": 0.0295174028724432,
      "pose_rmse_dtheta": 0.18909384310245514,
      "pose_rmse_dx": 0.055373065173625946,
      "pose_rmse_dy": 0.07274129986763,
      "pose_rmse_mean": 0.10573606938123703,
      "rmse_dtheta": 0.022802477702498436,
      "rmse_dx": 0.005061384290456772,
      "rmse_dy": 0.005990457255393267,
      "rmse_mean": 0.011284774169325829,
      "rotation_flip": 0.003464203327894211,
      "sparse_tokens": 32089.0,
      "step": 6112,
      "turn_loss": 0.0865296944975853,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.28400854859691504,
      "grad_norm": 0.5231131315231323,
      "learning_rate": 4.931246772055141e-06,
      "loss": 0.0884,
      "mae_dtheta": 0.009457215666770935,
      "mae_dx": 0.0014764370862394571,
      "mae_dy": 0.0020503380801528692,
      "pose_mae_dtheta": 0.06427228450775146,
      "pose_mae_dx": 0.0198375191539526,
      "pose_mae_dy": 0.0292770154774189,
      "pose_rmse_dtheta": 0.1542142629623413,
      "pose_rmse_dx": 0.05996893346309662,
      "pose_rmse_dy": 0.07809725403785706,
      "pose_rmse_mean": 0.09742681682109833,
      "rmse_dtheta": 0.019716830924153328,
      "rmse_dx": 0.005557927303016186,
      "rmse_dy": 0.004287384916096926,
      "rmse_mean": 0.009854047559201717,
      "rotation_flip": 0.003874091897159815,
      "sparse_tokens": 32041.0,
      "step": 6113,
      "turn_loss": 0.07043112814426422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2840550083627579,
      "grad_norm": 0.6534252762794495,
      "learning_rate": 4.929924680352899e-06,
      "loss": 0.1494,
      "mae_dtheta": 0.011568962596356869,
      "mae_dx": 0.0015889194328337908,
      "mae_dy": 0.0027652736753225327,
      "pose_mae_dtheta": 0.06922388821840286,
      "pose_mae_dx": 0.021527152508497238,
      "pose_mae_dy": 0.030502378940582275,
      "pose_rmse_dtheta": 0.13650354743003845,
      "pose_rmse_dx": 0.04665077477693558,
      "pose_rmse_dy": 0.06618773192167282,
      "pose_rmse_mean": 0.08311402052640915,
      "rmse_dtheta": 0.021812930703163147,
      "rmse_dx": 0.004141571465879679,
      "rmse_dy": 0.005264060106128454,
      "rmse_mean": 0.010406187735497952,
      "rotation_flip": 0.009216589853167534,
      "sparse_tokens": 32121.0,
      "step": 6114,
      "turn_loss": 0.1282694935798645,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.28410146812860065,
      "grad_norm": 0.456769198179245,
      "learning_rate": 4.928602593551065e-06,
      "loss": 0.0934,
      "mae_dtheta": 0.0068034883588552475,
      "mae_dx": 0.0017925625434145331,
      "mae_dy": 0.0013417763402685523,
      "pose_mae_dtheta": 0.04449644684791565,
      "pose_mae_dx": 0.0161985345184803,
      "pose_mae_dy": 0.016425414010882378,
      "pose_rmse_dtheta": 0.1299746185541153,
      "pose_rmse_dx": 0.04203249514102936,
      "pose_rmse_dy": 0.04099219664931297,
      "pose_rmse_mean": 0.07099977135658264,
      "rmse_dtheta": 0.018325960263609886,
      "rmse_dx": 0.005761618725955486,
      "rmse_dy": 0.0033498527482151985,
      "rmse_mean": 0.009145810268819332,
      "rotation_flip": 0.002114164875820279,
      "sparse_tokens": 32121.0,
      "step": 6115,
      "turn_loss": 0.06389624625444412,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.28414792789444343,
      "grad_norm": 0.43897131085395813,
      "learning_rate": 4.927280511742087e-06,
      "loss": 0.0971,
      "mae_dtheta": 0.0349472239613533,
      "mae_dx": 0.010512338019907475,
      "mae_dy": 0.005735344719141722,
      "pose_mae_dtheta": 0.2690075635910034,
      "pose_mae_dx": 0.10122410953044891,
      "pose_mae_dy": 0.06788630038499832,
      "pose_rmse_dtheta": 0.46931537985801697,
      "pose_rmse_dx": 0.24075360596179962,
      "pose_rmse_dy": 0.12556098401546478,
      "pose_rmse_mean": 0.2785433530807495,
      "rmse_dtheta": 0.05212678387761116,
      "rmse_dx": 0.022979585453867912,
      "rmse_dy": 0.010839836671948433,
      "rmse_mean": 0.028648734092712402,
      "rotation_flip": 0.008571428246796131,
      "sparse_tokens": 12829.0,
      "step": 6116,
      "turn_loss": 0.3401789665222168,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2841943876602862,
      "grad_norm": 0.5434756875038147,
      "learning_rate": 4.925958435018424e-06,
      "loss": 0.0857,
      "mae_dtheta": 0.008656279183924198,
      "mae_dx": 0.0018406183226034045,
      "mae_dy": 0.0020170060452073812,
      "pose_mae_dtheta": 0.05553765222430229,
      "pose_mae_dx": 0.01939273253083229,
      "pose_mae_dy": 0.020900147035717964,
      "pose_rmse_dtheta": 0.18083518743515015,
      "pose_rmse_dx": 0.06427614390850067,
      "pose_rmse_dy": 0.048665884882211685,
      "pose_rmse_mean": 0.09792574495077133,
      "rmse_dtheta": 0.023608913645148277,
      "rmse_dx": 0.005823291838169098,
      "rmse_dy": 0.0053107477724552155,
      "rmse_mean": 0.011580984108150005,
      "rotation_flip": 0.004468275234103203,
      "sparse_tokens": 32089.0,
      "step": 6117,
      "turn_loss": 0.06518089771270752,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30723.0,
      "epoch": 0.284240847426129,
      "grad_norm": 0.5114792585372925,
      "learning_rate": 4.924636363472526e-06,
      "loss": 0.1823,
      "mae_dtheta": 0.04821988567709923,
      "mae_dx": 0.01604674942791462,
      "mae_dy": 0.00774625176563859,
      "pose_mae_dtheta": 0.40209418535232544,
      "pose_mae_dx": 0.1373359113931656,
      "pose_mae_dy": 0.09801343083381653,
      "pose_rmse_dtheta": 0.6355828046798706,
      "pose_rmse_dx": 0.2796957790851593,
      "pose_rmse_dy": 0.22113606333732605,
      "pose_rmse_mean": 0.37880489230155945,
      "rmse_dtheta": 0.06658174842596054,
      "rmse_dx": 0.02930317260324955,
      "rmse_dy": 0.015264117158949375,
      "rmse_mean": 0.037049680948257446,
      "rotation_flip": 0.012048192322254181,
      "sparse_tokens": 24287.0,
      "step": 6118,
      "turn_loss": 0.4069588780403137,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 17859.0,
      "epoch": 0.28428730719197176,
      "grad_norm": 0.6838762164115906,
      "learning_rate": 4.923314297196847e-06,
      "loss": 0.1714,
      "mae_dtheta": 0.023173943161964417,
      "mae_dx": 0.010784291662275791,
      "mae_dy": 0.002765775891020894,
      "pose_mae_dtheta": 0.18835613131523132,
      "pose_mae_dx": 0.09450733661651611,
      "pose_mae_dy": 0.03741471469402313,
      "pose_rmse_dtheta": 0.33749496936798096,
      "pose_rmse_dx": 0.2272757589817047,
      "pose_rmse_dy": 0.09133860468864441,
      "pose_rmse_mean": 0.21870312094688416,
      "rmse_dtheta": 0.038266994059085846,
      "rmse_dx": 0.023508738726377487,
      "rmse_dy": 0.0053748274222016335,
      "rmse_mean": 0.022383522242307663,
      "rotation_flip": 0.008025682531297207,
      "sparse_tokens": 12874.0,
      "step": 6119,
      "turn_loss": 0.18558456003665924,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.28433376695781454,
      "grad_norm": 0.5716268420219421,
      "learning_rate": 4.921992236283842e-06,
      "loss": 0.1143,
      "mae_dtheta": 0.010443861596286297,
      "mae_dx": 0.00257428758777678,
      "mae_dy": 0.0034020959865301847,
      "pose_mae_dtheta": 0.07477790862321854,
      "pose_mae_dx": 0.029088126495480537,
      "pose_mae_dy": 0.030329864472150803,
      "pose_rmse_dtheta": 0.21144261956214905,
      "pose_rmse_dx": 0.0852527916431427,
      "pose_rmse_dy": 0.0740571916103363,
      "pose_rmse_mean": 0.12358420342206955,
      "rmse_dtheta": 0.02429528348147869,
      "rmse_dx": 0.007658465299755335,
      "rmse_dy": 0.008516685105860233,
      "rmse_mean": 0.013490144163370132,
      "rotation_flip": 0.005130397621542215,
      "sparse_tokens": 32073.0,
      "step": 6120,
      "turn_loss": 0.10863395035266876,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.2843802267236573,
      "grad_norm": 0.5551832318305969,
      "learning_rate": 4.9206701808259605e-06,
      "loss": 0.1452,
      "mae_dtheta": 0.039127424359321594,
      "mae_dx": 0.009825600311160088,
      "mae_dy": 0.006000667344778776,
      "pose_mae_dtheta": 0.32569941878318787,
      "pose_mae_dx": 0.0780833438038826,
      "pose_mae_dy": 0.069008469581604,
      "pose_rmse_dtheta": 0.5892229080200195,
      "pose_rmse_dx": 0.1794271320104599,
      "pose_rmse_dy": 0.1630415916442871,
      "pose_rmse_mean": 0.3105638921260834,
      "rmse_dtheta": 0.061934102326631546,
      "rmse_dx": 0.02087838388979435,
      "rmse_dy": 0.013803825713694096,
      "rmse_mean": 0.03220544010400772,
      "rotation_flip": 0.012229539453983307,
      "sparse_tokens": 17927.0,
      "step": 6121,
      "turn_loss": 0.30526217818260193,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2844266864895001,
      "grad_norm": 0.4253612458705902,
      "learning_rate": 4.919348130915657e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.012066352181136608,
      "mae_dx": 0.0018055683467537165,
      "mae_dy": 0.002418458927422762,
      "pose_mae_dtheta": 0.07384109497070312,
      "pose_mae_dx": 0.020660806447267532,
      "pose_mae_dy": 0.026570819318294525,
      "pose_rmse_dtheta": 0.22404925525188446,
      "pose_rmse_dx": 0.05177653580904007,
      "pose_rmse_dy": 0.05657109618186951,
      "pose_rmse_mean": 0.11079896986484528,
      "rmse_dtheta": 0.027130497619509697,
      "rmse_dx": 0.005000190809369087,
      "rmse_dy": 0.005120411049574614,
      "rmse_mean": 0.012417033314704895,
      "rotation_flip": 0.00712105818092823,
      "sparse_tokens": 32153.0,
      "step": 6122,
      "turn_loss": 0.07906565070152283,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.28447314625534287,
      "grad_norm": 0.5369105339050293,
      "learning_rate": 4.918026086645381e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.007077623624354601,
      "mae_dx": 0.0016894962172955275,
      "mae_dy": 0.0003118342428933829,
      "pose_mae_dtheta": 0.05069664493203163,
      "pose_mae_dx": 0.012816253118216991,
      "pose_mae_dy": 0.0044912369921803474,
      "pose_rmse_dtheta": 0.1946554332971573,
      "pose_rmse_dx": 0.02785511501133442,
      "pose_rmse_dy": 0.013753068633377552,
      "pose_rmse_mean": 0.07875454425811768,
      "rmse_dtheta": 0.025108909234404564,
      "rmse_dx": 0.004474366083741188,
      "rmse_dy": 0.000687802501488477,
      "rmse_mean": 0.0100903594866395,
      "rotation_flip": 0.002218524692580104,
      "sparse_tokens": 32249.0,
      "step": 6123,
      "turn_loss": 0.04632677137851715,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.28451960602118564,
      "grad_norm": 0.4627777934074402,
      "learning_rate": 4.916704048107586e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.00694713369011879,
      "mae_dx": 0.0011470101308077574,
      "mae_dy": 0.0010251711355522275,
      "pose_mae_dtheta": 0.053311605006456375,
      "pose_mae_dx": 0.012204554863274097,
      "pose_mae_dy": 0.016014955937862396,
      "pose_rmse_dtheta": 0.18933796882629395,
      "pose_rmse_dx": 0.031003136187791824,
      "pose_rmse_dy": 0.046794869005680084,
      "pose_rmse_mean": 0.08904533088207245,
      "rmse_dtheta": 0.020168311893939972,
      "rmse_dx": 0.003235150594264269,
      "rmse_dy": 0.0024042362347245216,
      "rmse_mean": 0.008602566085755825,
      "rotation_flip": 0.0013464990770444274,
      "sparse_tokens": 32153.0,
      "step": 6124,
      "turn_loss": 0.048726100474596024,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.2845660657870284,
      "grad_norm": 0.9722042083740234,
      "learning_rate": 4.91538201539472e-06,
      "loss": 0.3122,
      "mae_dtheta": 0.02725912816822529,
      "mae_dx": 0.005067750345915556,
      "mae_dy": 0.0036058055702596903,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9722041487693787,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 143.60842895507812,
      "model/head/act_norm_mean": 105.82678616431451,
      "model/head/act_norm_min": 80.91867065429688,
      "model/head/act_over_embed": 72.72515821809877,
      "model/head/grad_frac": 0.11486097425222397,
      "model/head/grad_norm": 0.11166831851005554,
      "model/head/grad_zero_frac": 0.00022399387671612203,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6882875504032258,
      "model/head/update_ratio": 0.001907456200569868,
      "model/head/weight_delta": 8.991056442260742,
      "model/head/weight_delta_rel": 0.15772975981235504,
      "model/head/weight_norm": 58.54305648803711,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42081597447395325,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42081597447395325,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42081597447395325,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2891886773997253,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 1.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0,
      "model/modality_embedder.encoders.pose/weight_delta": 2.914198160171509,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09521593898534775,
      "model/modality_embedder.encoders.pose/weight_norm": 30.942432403564453,
      "model/modality_embedder/grad_frac": 0.0,
      "model/modality_embedder/grad_norm": 0.0,
      "model/modality_embedder/grad_zero_frac": 1.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0,
      "model/modality_embedder/weight_delta": 2.914198160171509,
      "model/modality_embedder/weight_delta_rel": 0.09521593898534775,
      "model/modality_embedder/weight_norm": 30.942432403564453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.3377685546875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.29442084293395,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.333586692810059,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.00814408906814,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10651331394910812,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.1035526841878891,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0037160771898925304,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3016984462738037,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08387528359889984,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.86612892150879,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 75.14129638671875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.167136696748592,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.787662506103516,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.607882594304115,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.11199822276830673,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.10888513922691345,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.003676880383864045,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.9166383743286133,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10103463381528854,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.61345672607422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 76.75709533691406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.976188476062468,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.617663383483887,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.851079913658207,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10673552751541138,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.1037687212228775,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.003393939696252346,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.1451985836029053,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10560987889766693,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.574708938598633,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.68028259277344,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.854666698668716,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.271234512329102,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.141987734823424,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10365324467420578,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.10077211260795593,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0033784140832722187,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.687401533126831,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09184262901544571,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.828229904174805,
      "model/normalizer/grad_frac": 0.44388240575790405,
      "model/normalizer/grad_norm": 0.43154430389404297,
      "model/normalizer/grad_zero_frac": 0.00018789641035255045,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0054986849427223206,
      "model/normalizer/weight_delta": 5.6901326179504395,
      "model/normalizer/weight_delta_rel": 0.07328561693429947,
      "model/normalizer/weight_norm": 78.48136901855469,
      "pose_mae_dtheta": 0.19873009622097015,
      "pose_mae_dx": 0.048888083547353745,
      "pose_mae_dy": 0.025177879258990288,
      "pose_rmse_dtheta": 0.38205280900001526,
      "pose_rmse_dx": 0.14515826106071472,
      "pose_rmse_dy": 0.06097007542848587,
      "pose_rmse_mean": 0.1960603892803192,
      "rmse_dtheta": 0.050174955278635025,
      "rmse_dx": 0.01313901785761118,
      "rmse_dy": 0.009244941174983978,
      "rmse_mean": 0.024186305701732635,
      "rotation_flip": 0.00968992244452238,
      "sparse_tokens": 8228.0,
      "step": 6125,
      "turn_loss": 0.23040875792503357,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2846125255528712,
      "grad_norm": 0.4363163113594055,
      "learning_rate": 4.914059988599235e-06,
      "loss": 0.0886,
      "mae_dtheta": 0.006350844632834196,
      "mae_dx": 0.0011416029883548617,
      "mae_dy": 0.0008857441134750843,
      "pose_mae_dtheta": 0.04938546568155289,
      "pose_mae_dx": 0.010814862325787544,
      "pose_mae_dy": 0.01695053093135357,
      "pose_rmse_dtheta": 0.15532286465168,
      "pose_rmse_dx": 0.025742124766111374,
      "pose_rmse_dy": 0.04830924794077873,
      "pose_rmse_mean": 0.07645808160305023,
      "rmse_dtheta": 0.018691454082727432,
      "rmse_dx": 0.003581652417778969,
      "rmse_dy": 0.0018139294115826488,
      "rmse_mean": 0.008029012009501457,
      "rotation_flip": 0.0005824111867696047,
      "sparse_tokens": 32121.0,
      "step": 6126,
      "turn_loss": 0.04467333108186722,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.284658985318714,
      "grad_norm": 0.5535059571266174,
      "learning_rate": 4.9127379678135825e-06,
      "loss": 0.1289,
      "mae_dtheta": 0.008813759312033653,
      "mae_dx": 0.0019216854125261307,
      "mae_dy": 0.002137488219887018,
      "pose_mae_dtheta": 0.05813189968466759,
      "pose_mae_dx": 0.022954849526286125,
      "pose_mae_dy": 0.025044512003660202,
      "pose_rmse_dtheta": 0.15298783779144287,
      "pose_rmse_dx": 0.07078820466995239,
      "pose_rmse_dy": 0.07036609202623367,
      "pose_rmse_mean": 0.09804737567901611,
      "rmse_dtheta": 0.020117316395044327,
      "rmse_dx": 0.007297450676560402,
      "rmse_dy": 0.004701276309788227,
      "rmse_mean": 0.01070534810423851,
      "rotation_flip": 0.005722460802644491,
      "sparse_tokens": 32041.0,
      "step": 6127,
      "turn_loss": 0.07401296496391296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.28470544508455675,
      "grad_norm": 0.4829840362071991,
      "learning_rate": 4.911415953130211e-06,
      "loss": 0.0978,
      "mae_dtheta": 0.010810509324073792,
      "mae_dx": 0.0031081191264092922,
      "mae_dy": 0.00410069152712822,
      "pose_mae_dtheta": 0.07514126598834991,
      "pose_mae_dx": 0.02775663323700428,
      "pose_mae_dy": 0.03100040927529335,
      "pose_rmse_dtheta": 0.2013905793428421,
      "pose_rmse_dx": 0.08638250827789307,
      "pose_rmse_dy": 0.07919766008853912,
      "pose_rmse_mean": 0.12232357263565063,
      "rmse_dtheta": 0.026451818645000458,
      "rmse_dx": 0.009206922724843025,
      "rmse_dy": 0.009938754141330719,
      "rmse_mean": 0.015199164859950542,
      "rotation_flip": 0.0060950834304094315,
      "sparse_tokens": 32105.0,
      "step": 6128,
      "turn_loss": 0.12698297202587128,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 40888.0,
      "epoch": 0.28475190485039953,
      "grad_norm": 0.4116988480091095,
      "learning_rate": 4.910093944641569e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.04042963683605194,
      "mae_dx": 0.008243652991950512,
      "mae_dy": 0.003369444515556097,
      "pose_mae_dtheta": 0.32525399327278137,
      "pose_mae_dx": 0.06821586936712265,
      "pose_mae_dy": 0.03313697129487991,
      "pose_rmse_dtheta": 0.5559266209602356,
      "pose_rmse_dx": 0.17265425622463226,
      "pose_rmse_dy": 0.11205976456403732,
      "pose_rmse_mean": 0.2802135646343231,
      "rmse_dtheta": 0.059961605817079544,
      "rmse_dx": 0.018819358199834824,
      "rmse_dy": 0.010998550802469254,
      "rmse_mean": 0.02992650493979454,
      "rotation_flip": 0.011482254602015018,
      "sparse_tokens": 29754.0,
      "step": 6129,
      "turn_loss": 0.2765008807182312,
      "turns": 126.0,
      "turns_per_sample": 126.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.28479836461624236,
      "grad_norm": 0.43390288949012756,
      "learning_rate": 4.908771942440105e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.007358019705861807,
      "mae_dx": 0.0014339260524138808,
      "mae_dy": 0.00033658742904663086,
      "pose_mae_dtheta": 0.0532846599817276,
      "pose_mae_dx": 0.011347656138241291,
      "pose_mae_dy": 0.004551398102194071,
      "pose_rmse_dtheta": 0.22603899240493774,
      "pose_rmse_dx": 0.025493109598755836,
      "pose_rmse_dy": 0.01065947487950325,
      "pose_rmse_mean": 0.08739720284938812,
      "rmse_dtheta": 0.027375204488635063,
      "rmse_dx": 0.00386194814927876,
      "rmse_dy": 0.0007639240357093513,
      "rmse_mean": 0.010667026042938232,
      "rotation_flip": 0.0029620854184031487,
      "sparse_tokens": 32201.0,
      "step": 6130,
      "turn_loss": 0.04887807369232178,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.28484482438208514,
      "grad_norm": 0.43641847372055054,
      "learning_rate": 4.907449946618268e-06,
      "loss": 0.1294,
      "mae_dtheta": 0.026649493724107742,
      "mae_dx": 0.012742667458951473,
      "mae_dy": 0.002690028864890337,
      "pose_mae_dtheta": 0.2004164159297943,
      "pose_mae_dx": 0.09770090132951736,
      "pose_mae_dy": 0.03176642954349518,
      "pose_rmse_dtheta": 0.4172721803188324,
      "pose_rmse_dx": 0.21930649876594543,
      "pose_rmse_dy": 0.07130203396081924,
      "pose_rmse_mean": 0.2359602451324463,
      "rmse_dtheta": 0.04560444504022598,
      "rmse_dx": 0.02537393942475319,
      "rmse_dy": 0.005168155301362276,
      "rmse_mean": 0.025382181629538536,
      "rotation_flip": 0.004878048785030842,
      "sparse_tokens": 7644.0,
      "step": 6131,
      "turn_loss": 0.20455200970172882,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2848912841479279,
      "grad_norm": 0.584725558757782,
      "learning_rate": 4.906127957268507e-06,
      "loss": 0.1807,
      "mae_dtheta": 0.012195783667266369,
      "mae_dx": 0.0020313849672675133,
      "mae_dy": 0.0016840447206050158,
      "pose_mae_dtheta": 0.08646924048662186,
      "pose_mae_dx": 0.02123282104730606,
      "pose_mae_dy": 0.0220186784863472,
      "pose_rmse_dtheta": 0.24493667483329773,
      "pose_rmse_dx": 0.055580705404281616,
      "pose_rmse_dy": 0.05752892419695854,
      "pose_rmse_mean": 0.11934876441955566,
      "rmse_dtheta": 0.030664846301078796,
      "rmse_dx": 0.006401382386684418,
      "rmse_dy": 0.004854427184909582,
      "rmse_mean": 0.01397355180233717,
      "rotation_flip": 0.004629629664123058,
      "sparse_tokens": 32121.0,
      "step": 6132,
      "turn_loss": 0.08523690700531006,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2849377439137707,
      "grad_norm": 0.6593255400657654,
      "learning_rate": 4.904805974483267e-06,
      "loss": 0.1445,
      "mae_dtheta": 0.01258566789329052,
      "mae_dx": 0.0032126971054822206,
      "mae_dy": 0.0030619699973613024,
      "pose_mae_dtheta": 0.08915188908576965,
      "pose_mae_dx": 0.029294248670339584,
      "pose_mae_dy": 0.03177622705698013,
      "pose_rmse_dtheta": 0.22196929156780243,
      "pose_rmse_dx": 0.08653763681650162,
      "pose_rmse_dy": 0.08125414699316025,
      "pose_rmse_mean": 0.1299203634262085,
      "rmse_dtheta": 0.025991709902882576,
      "rmse_dx": 0.010484191589057446,
      "rmse_dy": 0.007849298417568207,
      "rmse_mean": 0.014775066636502743,
      "rotation_flip": 0.005761316977441311,
      "sparse_tokens": 32073.0,
      "step": 6133,
      "turn_loss": 0.09936520457267761,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.28498420367961347,
      "grad_norm": 0.4962191581726074,
      "learning_rate": 4.903483998354998e-06,
      "loss": 0.1087,
      "mae_dtheta": 0.04086853936314583,
      "mae_dx": 0.0163850300014019,
      "mae_dy": 0.007279369980096817,
      "pose_mae_dtheta": 0.33670952916145325,
      "pose_mae_dx": 0.14445310831069946,
      "pose_mae_dy": 0.09687267988920212,
      "pose_rmse_dtheta": 0.5586580634117126,
      "pose_rmse_dx": 0.28699466586112976,
      "pose_rmse_dy": 0.1973748654127121,
      "pose_rmse_mean": 0.3476758599281311,
      "rmse_dtheta": 0.05893950164318085,
      "rmse_dx": 0.030418284237384796,
      "rmse_dy": 0.012745716609060764,
      "rmse_mean": 0.034034501761198044,
      "rotation_flip": 0.009622502140700817,
      "sparse_tokens": 22195.0,
      "step": 6134,
      "turn_loss": 0.39074140787124634,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.28503066344545624,
      "grad_norm": 0.5455875396728516,
      "learning_rate": 4.902162028976143e-06,
      "loss": 0.1473,
      "mae_dtheta": 0.0080903060734272,
      "mae_dx": 0.0012570185353979468,
      "mae_dy": 0.0014302247436717153,
      "pose_mae_dtheta": 0.05287928879261017,
      "pose_mae_dx": 0.015258301049470901,
      "pose_mae_dy": 0.019182253628969193,
      "pose_rmse_dtheta": 0.14922669529914856,
      "pose_rmse_dx": 0.04002487286925316,
      "pose_rmse_dy": 0.05430701747536659,
      "pose_rmse_mean": 0.0811861976981163,
      "rmse_dtheta": 0.021150508895516396,
      "rmse_dx": 0.00427476828917861,
      "rmse_dy": 0.004472413565963507,
      "rmse_mean": 0.009965897537767887,
      "rotation_flip": 0.005519317463040352,
      "sparse_tokens": 32089.0,
      "step": 6135,
      "turn_loss": 0.06794475018978119,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.285077123211299,
      "grad_norm": 0.6063374280929565,
      "learning_rate": 4.900840066439151e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.03393838554620743,
      "mae_dx": 0.013640751130878925,
      "mae_dy": 0.006077930796891451,
      "pose_mae_dtheta": 0.2482146918773651,
      "pose_mae_dx": 0.10196325182914734,
      "pose_mae_dy": 0.07615646719932556,
      "pose_rmse_dtheta": 0.4230342209339142,
      "pose_rmse_dx": 0.21555131673812866,
      "pose_rmse_dy": 0.1781385838985443,
      "pose_rmse_mean": 0.27224141359329224,
      "rmse_dtheta": 0.051476459950208664,
      "rmse_dx": 0.025912316516041756,
      "rmse_dy": 0.012030500918626785,
      "rmse_mean": 0.02980642579495907,
      "rotation_flip": 0.03403141349554062,
      "sparse_tokens": 7022.0,
      "step": 6136,
      "turn_loss": 0.2364359200000763,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.2851235829771418,
      "grad_norm": 0.45811519026756287,
      "learning_rate": 4.8995181108364655e-06,
      "loss": 0.0866,
      "mae_dtheta": 0.006194818764925003,
      "mae_dx": 0.0016175730852410197,
      "mae_dy": 0.0002772881416603923,
      "pose_mae_dtheta": 0.04313110560178757,
      "pose_mae_dx": 0.012926669791340828,
      "pose_mae_dy": 0.0035181022249162197,
      "pose_rmse_dtheta": 0.1693936139345169,
      "pose_rmse_dx": 0.030436644330620766,
      "pose_rmse_dy": 0.006741425022482872,
      "pose_rmse_mean": 0.06885723024606705,
      "rmse_dtheta": 0.023823382332921028,
      "rmse_dx": 0.004375418182462454,
      "rmse_dy": 0.0005738381878472865,
      "rmse_mean": 0.009590880014002323,
      "rotation_flip": 0.0005988024058751762,
      "sparse_tokens": 32233.0,
      "step": 6137,
      "turn_loss": 0.04568800330162048,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2851700427429846,
      "grad_norm": 0.5137237310409546,
      "learning_rate": 4.8981961622605315e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.01008652988821268,
      "mae_dx": 0.0016052057035267353,
      "mae_dy": 0.0020025481935590506,
      "pose_mae_dtheta": 0.07287004590034485,
      "pose_mae_dx": 0.018836403265595436,
      "pose_mae_dy": 0.02406013198196888,
      "pose_rmse_dtheta": 0.21882662177085876,
      "pose_rmse_dx": 0.046884551644325256,
      "pose_rmse_dy": 0.0646166279911995,
      "pose_rmse_mean": 0.11010926961898804,
      "rmse_dtheta": 0.02366843819618225,
      "rmse_dx": 0.0051475097425282,
      "rmse_dy": 0.005029204301536083,
      "rmse_mean": 0.01128171756863594,
      "rotation_flip": 0.0032867707777768373,
      "sparse_tokens": 32105.0,
      "step": 6138,
      "turn_loss": 0.07482437044382095,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.28521650250882735,
      "grad_norm": 0.4265404939651489,
      "learning_rate": 4.8968742208037976e-06,
      "loss": 0.111,
      "mae_dtheta": 0.0035129892639815807,
      "mae_dx": 0.0023854353930801153,
      "mae_dy": 0.000695954542607069,
      "pose_mae_dtheta": 0.024098848924040794,
      "pose_mae_dx": 0.021764064207673073,
      "pose_mae_dy": 0.010023870505392551,
      "pose_rmse_dtheta": 0.06685658544301987,
      "pose_rmse_dx": 0.08208808302879333,
      "pose_rmse_dy": 0.04154887795448303,
      "pose_rmse_mean": 0.06349785625934601,
      "rmse_dtheta": 0.011221346445381641,
      "rmse_dx": 0.008965796791017056,
      "rmse_dy": 0.0027663593646138906,
      "rmse_mean": 0.007651167921721935,
      "rotation_flip": 0.0029325513169169426,
      "sparse_tokens": 32073.0,
      "step": 6139,
      "turn_loss": 0.04668990150094032,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.28526296227467013,
      "grad_norm": 0.6246762275695801,
      "learning_rate": 4.895552286558702e-06,
      "loss": 0.1479,
      "mae_dtheta": 0.040344566106796265,
      "mae_dx": 0.00982845202088356,
      "mae_dy": 0.0055955578573048115,
      "pose_mae_dtheta": 0.3107307553291321,
      "pose_mae_dx": 0.07963845878839493,
      "pose_mae_dy": 0.06007760763168335,
      "pose_rmse_dtheta": 0.5684118270874023,
      "pose_rmse_dx": 0.18590059876441956,
      "pose_rmse_dy": 0.14103971421718597,
      "pose_rmse_mean": 0.2984507083892822,
      "rmse_dtheta": 0.060483165085315704,
      "rmse_dx": 0.02110583707690239,
      "rmse_dy": 0.011217666789889336,
      "rmse_mean": 0.030935555696487427,
      "rotation_flip": 0.016697587445378304,
      "sparse_tokens": 18460.0,
      "step": 6140,
      "turn_loss": 0.29208797216415405,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2853094220405129,
      "grad_norm": 0.41868650913238525,
      "learning_rate": 4.894230359617693e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.01006790716201067,
      "mae_dx": 0.0019983917009085417,
      "mae_dy": 0.002021578373387456,
      "pose_mae_dtheta": 0.06765695661306381,
      "pose_mae_dx": 0.023917725309729576,
      "pose_mae_dy": 0.026901930570602417,
      "pose_rmse_dtheta": 0.1610148549079895,
      "pose_rmse_dx": 0.06552033871412277,
      "pose_rmse_dy": 0.06299729645252228,
      "pose_rmse_mean": 0.09651082754135132,
      "rmse_dtheta": 0.02063276432454586,
      "rmse_dx": 0.00634937034919858,
      "rmse_dy": 0.004212481901049614,
      "rmse_mean": 0.010398205369710922,
      "rotation_flip": 0.005050505045801401,
      "sparse_tokens": 32105.0,
      "step": 6141,
      "turn_loss": 0.07419699430465698,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2853558818063557,
      "grad_norm": 0.47576382756233215,
      "learning_rate": 4.89290844007321e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.010676652193069458,
      "mae_dx": 0.0018473092932254076,
      "mae_dy": 0.002648698864504695,
      "pose_mae_dtheta": 0.06996195763349533,
      "pose_mae_dx": 0.024064283818006516,
      "pose_mae_dy": 0.03127896785736084,
      "pose_rmse_dtheta": 0.14041458070278168,
      "pose_rmse_dx": 0.06552266329526901,
      "pose_rmse_dy": 0.06946645677089691,
      "pose_rmse_mean": 0.0918012261390686,
      "rmse_dtheta": 0.020872952416539192,
      "rmse_dx": 0.0057112243957817554,
      "rmse_dy": 0.005865044891834259,
      "rmse_mean": 0.010816408321261406,
      "rotation_flip": 0.005328597035259008,
      "sparse_tokens": 32105.0,
      "step": 6142,
      "turn_loss": 0.08689265698194504,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.28540234157219846,
      "grad_norm": 0.4432292580604553,
      "learning_rate": 4.8915865280177e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.028286956250667572,
      "mae_dx": 0.008604099042713642,
      "mae_dy": 0.004063802305608988,
      "pose_mae_dtheta": 0.18863826990127563,
      "pose_mae_dx": 0.06076715886592865,
      "pose_mae_dy": 0.05238041281700134,
      "pose_rmse_dtheta": 0.3502459228038788,
      "pose_rmse_dx": 0.17797940969467163,
      "pose_rmse_dy": 0.11163987964391708,
      "pose_rmse_mean": 0.21328839659690857,
      "rmse_dtheta": 0.04381139948964119,
      "rmse_dx": 0.02078418619930744,
      "rmse_dy": 0.007407453376799822,
      "rmse_mean": 0.024001015350222588,
      "rotation_flip": 0.021852238103747368,
      "sparse_tokens": 15879.0,
      "step": 6143,
      "turn_loss": 0.19185179471969604,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.28544880133804124,
      "grad_norm": 0.28572335839271545,
      "learning_rate": 4.890264623543599e-06,
      "loss": 0.0792,
      "mae_dtheta": 0.013117358088493347,
      "mae_dx": 0.00188873999286443,
      "mae_dy": 0.0030477966647595167,
      "pose_mae_dtheta": 0.08294501900672913,
      "pose_mae_dx": 0.02324669435620308,
      "pose_mae_dy": 0.03075331076979637,
      "pose_rmse_dtheta": 0.21939684450626373,
      "pose_rmse_dx": 0.060447268187999725,
      "pose_rmse_dy": 0.0644473284482956,
      "pose_rmse_mean": 0.11476381868124008,
      "rmse_dtheta": 0.02732483111321926,
      "rmse_dx": 0.007148933596909046,
      "rmse_dy": 0.007478929590433836,
      "rmse_mean": 0.01398423220962286,
      "rotation_flip": 0.007336757145822048,
      "sparse_tokens": 32057.0,
      "step": 6144,
      "turn_loss": 0.10791345685720444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.285495261103884,
      "grad_norm": 0.49123406410217285,
      "learning_rate": 4.888942726743353e-06,
      "loss": 0.1425,
      "mae_dtheta": 0.009534604847431183,
      "mae_dx": 0.0011539701372385025,
      "mae_dy": 0.0014500420074909925,
      "pose_mae_dtheta": 0.061964329332113266,
      "pose_mae_dx": 0.013651764951646328,
      "pose_mae_dy": 0.021579710766673088,
      "pose_rmse_dtheta": 0.18489225208759308,
      "pose_rmse_dx": 0.038284189999103546,
      "pose_rmse_dy": 0.046888284385204315,
      "pose_rmse_mean": 0.09002158045768738,
      "rmse_dtheta": 0.023315222933888435,
      "rmse_dx": 0.003898938884958625,
      "rmse_dy": 0.0029496673960238695,
      "rmse_mean": 0.010054610669612885,
      "rotation_flip": 0.004233700223267078,
      "sparse_tokens": 32057.0,
      "step": 6145,
      "turn_loss": 0.06329789012670517,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2855417208697268,
      "grad_norm": 0.5022384524345398,
      "learning_rate": 4.8876208377094025e-06,
      "loss": 0.1167,
      "mae_dtheta": 0.009254242293536663,
      "mae_dx": 0.0014852158492431045,
      "mae_dy": 0.0020341267809271812,
      "pose_mae_dtheta": 0.06596819311380386,
      "pose_mae_dx": 0.016197113320231438,
      "pose_mae_dy": 0.019950957968831062,
      "pose_rmse_dtheta": 0.1809384971857071,
      "pose_rmse_dx": 0.0373469814658165,
      "pose_rmse_dy": 0.04950268566608429,
      "pose_rmse_mean": 0.08926272392272949,
      "rmse_dtheta": 0.022732866927981377,
      "rmse_dx": 0.00400330126285553,
      "rmse_dy": 0.005712668411433697,
      "rmse_mean": 0.010816278867423534,
      "rotation_flip": 0.0032490973826497793,
      "sparse_tokens": 32169.0,
      "step": 6146,
      "turn_loss": 0.07418658584356308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.2855881806355696,
      "grad_norm": 0.5998314023017883,
      "learning_rate": 4.8862989565341866e-06,
      "loss": 0.1951,
      "mae_dtheta": 0.03017323836684227,
      "mae_dx": 0.015039036981761456,
      "mae_dy": 0.004810728598386049,
      "pose_mae_dtheta": 0.22555853426456451,
      "pose_mae_dx": 0.13482584059238434,
      "pose_mae_dy": 0.06464137881994247,
      "pose_rmse_dtheta": 0.378483384847641,
      "pose_rmse_dx": 0.2870720326900482,
      "pose_rmse_dy": 0.1443951427936554,
      "pose_rmse_mean": 0.26998353004455566,
      "rmse_dtheta": 0.0444159135222435,
      "rmse_dx": 0.02859693579375744,
      "rmse_dy": 0.00968483928591013,
      "rmse_mean": 0.02756589651107788,
      "rotation_flip": 0.018115941435098648,
      "sparse_tokens": 10365.0,
      "step": 6147,
      "turn_loss": 0.21889296174049377,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2856346404014124,
      "grad_norm": 0.5592831969261169,
      "learning_rate": 4.884977083310146e-06,
      "loss": 0.1605,
      "mae_dtheta": 0.011954030022025108,
      "mae_dx": 0.0036212787963449955,
      "mae_dy": 0.004349445924162865,
      "pose_mae_dtheta": 0.0881982371211052,
      "pose_mae_dx": 0.04492738097906113,
      "pose_mae_dy": 0.032849401235580444,
      "pose_rmse_dtheta": 0.20591197907924652,
      "pose_rmse_dx": 0.14453405141830444,
      "pose_rmse_dy": 0.07797776907682419,
      "pose_rmse_mean": 0.1428079456090927,
      "rmse_dtheta": 0.025901785120368004,
      "rmse_dx": 0.009820694103837013,
      "rmse_dy": 0.010209303349256516,
      "rmse_mean": 0.01531059481203556,
      "rotation_flip": 0.0036805300042033195,
      "sparse_tokens": 32121.0,
      "step": 6148,
      "turn_loss": 0.14192171394824982,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.2856811001672552,
      "grad_norm": 0.396267294883728,
      "learning_rate": 4.883655218129719e-06,
      "loss": 0.0759,
      "mae_dtheta": 0.02977815270423889,
      "mae_dx": 0.013249707408249378,
      "mae_dy": 0.005538341589272022,
      "pose_mae_dtheta": 0.19847546517848969,
      "pose_mae_dx": 0.11154931783676147,
      "pose_mae_dy": 0.09298344701528549,
      "pose_rmse_dtheta": 0.3301912248134613,
      "pose_rmse_dx": 0.2457442283630371,
      "pose_rmse_dy": 0.17548365890979767,
      "pose_rmse_mean": 0.2504730522632599,
      "rmse_dtheta": 0.04538608714938164,
      "rmse_dx": 0.02611202374100685,
      "rmse_dy": 0.008728722110390663,
      "rmse_mean": 0.026742277666926384,
      "rotation_flip": 0.018691588193178177,
      "sparse_tokens": 7168.0,
      "step": 6149,
      "turn_loss": 0.2682577669620514,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 21358.0,
      "epoch": 0.28572755993309795,
      "grad_norm": 0.47709158062934875,
      "learning_rate": 4.882333361085345e-06,
      "loss": 0.0983,
      "mae_dtheta": 0.028121598064899445,
      "mae_dx": 0.010669779032468796,
      "mae_dy": 0.005578262731432915,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.47709158062934875,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.09007263183594,
      "model/head/act_norm_mean": 116.42100201231061,
      "model/head/act_norm_min": 77.1938705444336,
      "model/head/act_over_embed": 80.00560253345314,
      "model/head/grad_frac": 0.09284928441047668,
      "model/head/grad_norm": 0.04429761320352554,
      "model/head/grad_zero_frac": 0.00016466404485981911,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7038352272727273,
      "model/head/update_ratio": 0.0007566283456981182,
      "model/head/weight_delta": 9.004526138305664,
      "model/head/weight_delta_rel": 0.15796606242656708,
      "model/head/weight_norm": 58.54606628417969,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42078331112861633,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42078331112861633,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42078331112861633,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28916623084301074,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10003040730953217,
      "model/modality_embedder.encoders.pose/grad_norm": 0.047723665833473206,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015423084842041135,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9213521480560303,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09544967859983444,
      "model/modality_embedder.encoders.pose/weight_norm": 30.943008422851562,
      "model/modality_embedder/grad_frac": 0.10003040730953217,
      "model/modality_embedder/grad_norm": 0.047723665833473206,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0015423084842041135,
      "model/modality_embedder/weight_delta": 2.9213521480560303,
      "model/modality_embedder/weight_delta_rel": 0.09544967859983444,
      "model/modality_embedder/weight_norm": 30.943008422851562,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.57461547851562,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.16148275913901,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.163206100463867,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.60399715544581,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07916411012411118,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03776853159070015,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001355321379378438,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3067188262939453,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08405822515487671,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.866846084594727,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.9051513671875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.948316874098126,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.566950798034668,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.14471692570276,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07729583233594894,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03687719255685806,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012452153023332357,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.9233813285827637,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1012682169675827,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.6151123046875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.42557525634766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.55816348003848,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.504164695739746,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.251018584926353,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07841555774211884,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0374114029109478,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012235461035743356,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.1523241996765137,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10584914684295654,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.576210021972656,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.75043487548828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.454474056036556,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.618226051330566,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.554180966291554,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1025063619017601,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04890492185950279,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016394730191677809,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.6936819553375244,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09205726534128189,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.82965850830078,
      "model/normalizer/grad_frac": 0.36989694833755493,
      "model/normalizer/grad_norm": 0.17647472023963928,
      "model/normalizer/grad_zero_frac": 0.0001784424966899678,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0022485649678856134,
      "model/normalizer/weight_delta": 5.70315408706665,
      "model/normalizer/weight_delta_rel": 0.07345332205295563,
      "model/normalizer/weight_norm": 78.48326873779297,
      "pose_mae_dtheta": 0.2105223387479782,
      "pose_mae_dx": 0.09354183822870255,
      "pose_mae_dy": 0.07795519381761551,
      "pose_rmse_dtheta": 0.3684350550174713,
      "pose_rmse_dx": 0.22817042469978333,
      "pose_rmse_dy": 0.1509825438261032,
      "pose_rmse_mean": 0.24919602274894714,
      "rmse_dtheta": 0.04214545711874962,
      "rmse_dx": 0.024545343592762947,
      "rmse_dy": 0.009419805370271206,
      "rmse_mean": 0.025370202958583832,
      "rotation_flip": 0.01835853047668934,
      "sparse_tokens": 18064.0,
      "step": 6150,
      "turn_loss": 0.26661086082458496,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 17211.0,
      "epoch": 0.28577401969894073,
      "grad_norm": 0.5630936026573181,
      "learning_rate": 4.881011512269464e-06,
      "loss": 0.123,
      "mae_dtheta": 0.015129880979657173,
      "mae_dx": 0.006380958948284388,
      "mae_dy": 0.002175139496102929,
      "pose_mae_dtheta": 0.09321651607751846,
      "pose_mae_dx": 0.042410872876644135,
      "pose_mae_dy": 0.02963583916425705,
      "pose_rmse_dtheta": 0.1823083609342575,
      "pose_rmse_dx": 0.14157092571258545,
      "pose_rmse_dy": 0.0761042907834053,
      "pose_rmse_mean": 0.13332787156105042,
      "rmse_dtheta": 0.028695600107312202,
      "rmse_dx": 0.017562126740813255,
      "rmse_dy": 0.004243583418428898,
      "rmse_mean": 0.016833771020174026,
      "rotation_flip": 0.008650518953800201,
      "sparse_tokens": 12601.0,
      "step": 6151,
      "turn_loss": 0.13293394446372986,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.2858204794647835,
      "grad_norm": 0.5288097858428955,
      "learning_rate": 4.879689671774509e-06,
      "loss": 0.1931,
      "mae_dtheta": 0.0461493618786335,
      "mae_dx": 0.012433021329343319,
      "mae_dy": 0.007891608402132988,
      "pose_mae_dtheta": 0.36813101172447205,
      "pose_mae_dx": 0.10812898725271225,
      "pose_mae_dy": 0.07343639433383942,
      "pose_rmse_dtheta": 0.6181347966194153,
      "pose_rmse_dx": 0.2165597528219223,
      "pose_rmse_dy": 0.16566476225852966,
      "pose_rmse_mean": 0.33345311880111694,
      "rmse_dtheta": 0.06520142406225204,
      "rmse_dx": 0.023063382133841515,
      "rmse_dy": 0.015031863003969193,
      "rmse_mean": 0.03443222492933273,
      "rotation_flip": 0.019577134400606155,
      "sparse_tokens": 19812.0,
      "step": 6152,
      "turn_loss": 0.36577367782592773,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2858669392306263,
      "grad_norm": 0.42919042706489563,
      "learning_rate": 4.878367839692923e-06,
      "loss": 0.1237,
      "mae_dtheta": 0.00855780765414238,
      "mae_dx": 0.0012207417748868465,
      "mae_dy": 0.0019890465773642063,
      "pose_mae_dtheta": 0.055021654814481735,
      "pose_mae_dx": 0.016979767009615898,
      "pose_mae_dy": 0.02042209729552269,
      "pose_rmse_dtheta": 0.17950229346752167,
      "pose_rmse_dx": 0.045431893318891525,
      "pose_rmse_dy": 0.05084250122308731,
      "pose_rmse_mean": 0.09192556142807007,
      "rmse_dtheta": 0.02157222107052803,
      "rmse_dx": 0.00348745402880013,
      "rmse_dy": 0.005131994839757681,
      "rmse_mean": 0.010063890367746353,
      "rotation_flip": 0.0056523787789046764,
      "sparse_tokens": 32057.0,
      "step": 6153,
      "turn_loss": 0.06898319721221924,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.28591339899646906,
      "grad_norm": 0.409434050321579,
      "learning_rate": 4.877046016117136e-06,
      "loss": 0.1093,
      "mae_dtheta": 0.008703702129423618,
      "mae_dx": 0.0014924990246072412,
      "mae_dy": 0.0020916119683533907,
      "pose_mae_dtheta": 0.05826711654663086,
      "pose_mae_dx": 0.02007889933884144,
      "pose_mae_dy": 0.024204721674323082,
      "pose_rmse_dtheta": 0.14508873224258423,
      "pose_rmse_dx": 0.04820955917239189,
      "pose_rmse_dy": 0.05369912460446358,
      "pose_rmse_mean": 0.08233247697353363,
      "rmse_dtheta": 0.01931827887892723,
      "rmse_dx": 0.004563617054373026,
      "rmse_dy": 0.004702123813331127,
      "rmse_mean": 0.009528006426990032,
      "rotation_flip": 0.0016293278895318508,
      "sparse_tokens": 32089.0,
      "step": 6154,
      "turn_loss": 0.07096532732248306,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.28595985876231184,
      "grad_norm": 0.4293380677700043,
      "learning_rate": 4.87572420113959e-06,
      "loss": 0.1018,
      "mae_dtheta": 0.008074747398495674,
      "mae_dx": 0.001288379542529583,
      "mae_dy": 0.0011331208515912294,
      "pose_mae_dtheta": 0.05925927683711052,
      "pose_mae_dx": 0.012805428355932236,
      "pose_mae_dy": 0.014057754538953304,
      "pose_rmse_dtheta": 0.21063080430030823,
      "pose_rmse_dx": 0.03450426831841469,
      "pose_rmse_dy": 0.048960957676172256,
      "pose_rmse_mean": 0.09803201258182526,
      "rmse_dtheta": 0.02483910135924816,
      "rmse_dx": 0.004037523176521063,
      "rmse_dy": 0.0031363535672426224,
      "rmse_mean": 0.01067099254578352,
      "rotation_flip": 0.004584819078445435,
      "sparse_tokens": 32153.0,
      "step": 6155,
      "turn_loss": 0.0595102421939373,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2860063185281546,
      "grad_norm": 0.4576939642429352,
      "learning_rate": 4.874402394852715e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.008620144799351692,
      "mae_dx": 0.0020005381666123867,
      "mae_dy": 0.002283379901200533,
      "pose_mae_dtheta": 0.06121906265616417,
      "pose_mae_dx": 0.021999867632985115,
      "pose_mae_dy": 0.022663746029138565,
      "pose_rmse_dtheta": 0.18527597188949585,
      "pose_rmse_dx": 0.06675785034894943,
      "pose_rmse_dy": 0.060796622186899185,
      "pose_rmse_mean": 0.10427682101726532,
      "rmse_dtheta": 0.02338242158293724,
      "rmse_dx": 0.006085145752876997,
      "rmse_dy": 0.006708165630698204,
      "rmse_mean": 0.012058578431606293,
      "rotation_flip": 0.003470500698313117,
      "sparse_tokens": 32089.0,
      "step": 6156,
      "turn_loss": 0.06737445294857025,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2860527782939974,
      "grad_norm": 0.45326271653175354,
      "learning_rate": 4.873080597348948e-06,
      "loss": 0.1218,
      "mae_dtheta": 0.011983443051576614,
      "mae_dx": 0.0016463256906718016,
      "mae_dy": 0.0020462917163968086,
      "pose_mae_dtheta": 0.08040022850036621,
      "pose_mae_dx": 0.02028571628034115,
      "pose_mae_dy": 0.025017082691192627,
      "pose_rmse_dtheta": 0.2212345451116562,
      "pose_rmse_dx": 0.05536825582385063,
      "pose_rmse_dy": 0.06086104363203049,
      "pose_rmse_mean": 0.11248795688152313,
      "rmse_dtheta": 0.028163136914372444,
      "rmse_dx": 0.004698606673628092,
      "rmse_dy": 0.004803513176739216,
      "rmse_mean": 0.012555085122585297,
      "rotation_flip": 0.004984662402421236,
      "sparse_tokens": 32169.0,
      "step": 6157,
      "turn_loss": 0.08662445098161697,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.28609923805984017,
      "grad_norm": 0.9973860383033752,
      "learning_rate": 4.871758808720724e-06,
      "loss": 0.2845,
      "mae_dtheta": 0.03658539429306984,
      "mae_dx": 0.009876370429992676,
      "mae_dy": 0.0041389125399291515,
      "pose_mae_dtheta": 0.2825951874256134,
      "pose_mae_dx": 0.07160650938749313,
      "pose_mae_dy": 0.04734070971608162,
      "pose_rmse_dtheta": 0.5290982723236084,
      "pose_rmse_dx": 0.16677500307559967,
      "pose_rmse_dy": 0.12222450971603394,
      "pose_rmse_mean": 0.2726992666721344,
      "rmse_dtheta": 0.057437311857938766,
      "rmse_dx": 0.02112666331231594,
      "rmse_dy": 0.00846952386200428,
      "rmse_mean": 0.029011165723204613,
      "rotation_flip": 0.008620689623057842,
      "sparse_tokens": 18429.0,
      "step": 6158,
      "turn_loss": 0.23008520901203156,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.28614569782568294,
      "grad_norm": 0.44900888204574585,
      "learning_rate": 4.870437029060474e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.04545816406607628,
      "mae_dx": 0.010782706551253796,
      "mae_dy": 0.007719369605183601,
      "pose_mae_dtheta": 0.3741150498390198,
      "pose_mae_dx": 0.08051757514476776,
      "pose_mae_dy": 0.1101922020316124,
      "pose_rmse_dtheta": 0.6352331042289734,
      "pose_rmse_dx": 0.18519307672977448,
      "pose_rmse_dy": 0.2487448751926422,
      "pose_rmse_mean": 0.3563903570175171,
      "rmse_dtheta": 0.06819398701190948,
      "rmse_dx": 0.02391815185546875,
      "rmse_dy": 0.015002066269516945,
      "rmse_mean": 0.03570473566651344,
      "rotation_flip": 0.023746700957417488,
      "sparse_tokens": 6382.0,
      "step": 6159,
      "turn_loss": 0.24653509259223938,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.2861921575915257,
      "grad_norm": 0.37379205226898193,
      "learning_rate": 4.869115258460636e-06,
      "loss": 0.101,
      "mae_dtheta": 0.03849874064326286,
      "mae_dx": 0.015251941047608852,
      "mae_dy": 0.0044525968842208385,
      "pose_mae_dtheta": 0.29505273699760437,
      "pose_mae_dx": 0.11609212309122086,
      "pose_mae_dy": 0.04614468663930893,
      "pose_rmse_dtheta": 0.5378387570381165,
      "pose_rmse_dx": 0.24149373173713684,
      "pose_rmse_dy": 0.12654681503772736,
      "pose_rmse_mean": 0.3019597828388214,
      "rmse_dtheta": 0.058470241725444794,
      "rmse_dx": 0.027544956654310226,
      "rmse_dy": 0.010714899748563766,
      "rmse_mean": 0.03224336728453636,
      "rotation_flip": 0.007611798122525215,
      "sparse_tokens": 18324.0,
      "step": 6160,
      "turn_loss": 0.2811647057533264,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.2862386173573685,
      "grad_norm": 0.4965663254261017,
      "learning_rate": 4.867793497013634e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.025614328682422638,
      "mae_dx": 0.0058695171028375626,
      "mae_dy": 0.003965584561228752,
      "pose_mae_dtheta": 0.18654286861419678,
      "pose_mae_dx": 0.042757101356983185,
      "pose_mae_dy": 0.04359515756368637,
      "pose_rmse_dtheta": 0.38109803199768066,
      "pose_rmse_dx": 0.11833105236291885,
      "pose_rmse_dy": 0.11574504524469376,
      "pose_rmse_mean": 0.2050580382347107,
      "rmse_dtheta": 0.04448901489377022,
      "rmse_dx": 0.015045007690787315,
      "rmse_dy": 0.008742136880755424,
      "rmse_mean": 0.022758720442652702,
      "rotation_flip": 0.013245033100247383,
      "sparse_tokens": 19780.0,
      "step": 6161,
      "turn_loss": 0.17125025391578674,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.2862850771232113,
      "grad_norm": 1.190190076828003,
      "learning_rate": 4.866471744811906e-06,
      "loss": 0.2634,
      "mae_dtheta": 0.03503746539354324,
      "mae_dx": 0.008082184009253979,
      "mae_dy": 0.00770944356918335,
      "pose_mae_dtheta": 0.2987772524356842,
      "pose_mae_dx": 0.08259384334087372,
      "pose_mae_dy": 0.0775604099035263,
      "pose_rmse_dtheta": 0.4682370126247406,
      "pose_rmse_dx": 0.21291983127593994,
      "pose_rmse_dy": 0.1436021625995636,
      "pose_rmse_mean": 0.27491968870162964,
      "rmse_dtheta": 0.050978053361177444,
      "rmse_dx": 0.019578563049435616,
      "rmse_dy": 0.014105765148997307,
      "rmse_mean": 0.02822079509496689,
      "rotation_flip": 0.022624434903264046,
      "sparse_tokens": 3792.0,
      "step": 6162,
      "turn_loss": 0.27936986088752747,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.2863315368890541,
      "grad_norm": 0.559544563293457,
      "learning_rate": 4.86515000194788e-06,
      "loss": 0.141,
      "mae_dtheta": 0.007540099788457155,
      "mae_dx": 0.0012742724502459168,
      "mae_dy": 0.00020790025882888585,
      "pose_mae_dtheta": 0.05497914180159569,
      "pose_mae_dx": 0.009756935760378838,
      "pose_mae_dy": 0.0024049803614616394,
      "pose_rmse_dtheta": 0.25260671973228455,
      "pose_rmse_dx": 0.02135043404996395,
      "pose_rmse_dy": 0.004543459974229336,
      "pose_rmse_mean": 0.09283354133367538,
      "rmse_dtheta": 0.02970268949866295,
      "rmse_dx": 0.0034179207868874073,
      "rmse_dy": 0.00048538262490183115,
      "rmse_mean": 0.011201998218894005,
      "rotation_flip": 0.0016198704252019525,
      "sparse_tokens": 32249.0,
      "step": 6163,
      "turn_loss": 0.041437625885009766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2863779966548969,
      "grad_norm": 0.579292893409729,
      "learning_rate": 4.863828268513985e-06,
      "loss": 0.1215,
      "mae_dtheta": 0.009706730954349041,
      "mae_dx": 0.0010607964359223843,
      "mae_dy": 0.002136608585715294,
      "pose_mae_dtheta": 0.06774226576089859,
      "pose_mae_dx": 0.018991857767105103,
      "pose_mae_dy": 0.032451026141643524,
      "pose_rmse_dtheta": 0.16189804673194885,
      "pose_rmse_dx": 0.05285611003637314,
      "pose_rmse_dy": 0.09774543344974518,
      "pose_rmse_mean": 0.10416653007268906,
      "rmse_dtheta": 0.021109895780682564,
      "rmse_dx": 0.0035689575597643852,
      "rmse_dy": 0.005354389548301697,
      "rmse_mean": 0.010011080652475357,
      "rotation_flip": 0.004362578969448805,
      "sparse_tokens": 32057.0,
      "step": 6164,
      "turn_loss": 0.07308562844991684,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.28642445642073966,
      "grad_norm": 0.6899304986000061,
      "learning_rate": 4.862506544602654e-06,
      "loss": 0.1602,
      "mae_dtheta": 0.01615133136510849,
      "mae_dx": 0.005036638583987951,
      "mae_dy": 0.003197548445314169,
      "pose_mae_dtheta": 0.11867447942495346,
      "pose_mae_dx": 0.04805909842252731,
      "pose_mae_dy": 0.037535443902015686,
      "pose_rmse_dtheta": 0.2977960705757141,
      "pose_rmse_dx": 0.1462375968694687,
      "pose_rmse_dy": 0.09120996296405792,
      "pose_rmse_mean": 0.17841455340385437,
      "rmse_dtheta": 0.03445233404636383,
      "rmse_dx": 0.015679560601711273,
      "rmse_dy": 0.008037418127059937,
      "rmse_mean": 0.019389770925045013,
      "rotation_flip": 0.010172490030527115,
      "sparse_tokens": 32089.0,
      "step": 6165,
      "turn_loss": 0.1867339015007019,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.28647091618658244,
      "grad_norm": 0.4413205683231354,
      "learning_rate": 4.861184830306314e-06,
      "loss": 0.0757,
      "mae_dtheta": 0.009194085374474525,
      "mae_dx": 0.0011835587210953236,
      "mae_dy": 0.0022134874016046524,
      "pose_mae_dtheta": 0.059691354632377625,
      "pose_mae_dx": 0.0173787958920002,
      "pose_mae_dy": 0.027380770072340965,
      "pose_rmse_dtheta": 0.15386660397052765,
      "pose_rmse_dx": 0.04898639768362045,
      "pose_rmse_dy": 0.06206844374537468,
      "pose_rmse_mean": 0.08830714225769043,
      "rmse_dtheta": 0.020923670381307602,
      "rmse_dx": 0.0031142025254666805,
      "rmse_dy": 0.004565848037600517,
      "rmse_mean": 0.00953457411378622,
      "rotation_flip": 0.0042765503749251366,
      "sparse_tokens": 32121.0,
      "step": 6166,
      "turn_loss": 0.07594632357358932,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2865173759524252,
      "grad_norm": 0.360431969165802,
      "learning_rate": 4.859863125717394e-06,
      "loss": 0.0905,
      "mae_dtheta": 0.007738890126347542,
      "mae_dx": 0.001564976293593645,
      "mae_dy": 0.0018684278475120664,
      "pose_mae_dtheta": 0.050699494779109955,
      "pose_mae_dx": 0.020237188786268234,
      "pose_mae_dy": 0.021559640765190125,
      "pose_rmse_dtheta": 0.10381428897380829,
      "pose_rmse_dx": 0.05198217183351517,
      "pose_rmse_dy": 0.04910903796553612,
      "pose_rmse_mean": 0.06830184161663055,
      "rmse_dtheta": 0.016267087310552597,
      "rmse_dx": 0.004772441927343607,
      "rmse_dy": 0.004027193877846003,
      "rmse_mean": 0.008355574682354927,
      "rotation_flip": 0.002747252816334367,
      "sparse_tokens": 32089.0,
      "step": 6167,
      "turn_loss": 0.06907728314399719,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32986.0,
      "epoch": 0.286563835718268,
      "grad_norm": 0.5990444421768188,
      "learning_rate": 4.85854143092832e-06,
      "loss": 0.1754,
      "mae_dtheta": 0.03864166513085365,
      "mae_dx": 0.01194724626839161,
      "mae_dy": 0.004572231322526932,
      "pose_mae_dtheta": 0.30576005578041077,
      "pose_mae_dx": 0.09666270762681961,
      "pose_mae_dy": 0.05026418715715408,
      "pose_rmse_dtheta": 0.5361114740371704,
      "pose_rmse_dx": 0.2251800149679184,
      "pose_rmse_dy": 0.12998245656490326,
      "pose_rmse_mean": 0.2970913350582123,
      "rmse_dtheta": 0.057720936834812164,
      "rmse_dx": 0.024540936574339867,
      "rmse_dy": 0.009729301556944847,
      "rmse_mean": 0.03066372685134411,
      "rotation_flip": 0.01532033458352089,
      "sparse_tokens": 25585.0,
      "step": 6168,
      "turn_loss": 0.32869869470596313,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.28661029548411077,
      "grad_norm": 0.6360881924629211,
      "learning_rate": 4.85721974603152e-06,
      "loss": 0.1415,
      "mae_dtheta": 0.03678334504365921,
      "mae_dx": 0.009499349631369114,
      "mae_dy": 0.008574921637773514,
      "pose_mae_dtheta": 0.29880326986312866,
      "pose_mae_dx": 0.06143316254019737,
      "pose_mae_dy": 0.06659543514251709,
      "pose_rmse_dtheta": 0.5332416892051697,
      "pose_rmse_dx": 0.1900421679019928,
      "pose_rmse_dy": 0.14805586636066437,
      "pose_rmse_mean": 0.29044657945632935,
      "rmse_dtheta": 0.05917644873261452,
      "rmse_dx": 0.02214900776743889,
      "rmse_dy": 0.017049482092261314,
      "rmse_mean": 0.03279164806008339,
      "rotation_flip": 0.01655629090964794,
      "sparse_tokens": 5263.0,
      "step": 6169,
      "turn_loss": 0.3398464620113373,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 17213.0,
      "epoch": 0.28665675524995354,
      "grad_norm": 0.4383239150047302,
      "learning_rate": 4.85589807111942e-06,
      "loss": 0.096,
      "mae_dtheta": 0.028845511376857758,
      "mae_dx": 0.01105333399027586,
      "mae_dy": 0.0038218044210225344,
      "pose_mae_dtheta": 0.20889928936958313,
      "pose_mae_dx": 0.07612546533346176,
      "pose_mae_dy": 0.04950923100113869,
      "pose_rmse_dtheta": 0.3758750855922699,
      "pose_rmse_dx": 0.18610908091068268,
      "pose_rmse_dy": 0.10867699235677719,
      "pose_rmse_mean": 0.22355371713638306,
      "rmse_dtheta": 0.04582187905907631,
      "rmse_dx": 0.02320886217057705,
      "rmse_dy": 0.007080855779349804,
      "rmse_mean": 0.025370530784130096,
      "rotation_flip": 0.010126582346856594,
      "sparse_tokens": 13548.0,
      "step": 6170,
      "turn_loss": 0.19622215628623962,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.2867032150157963,
      "grad_norm": 0.5602770447731018,
      "learning_rate": 4.854576406284443e-06,
      "loss": 0.1556,
      "mae_dtheta": 0.03149200603365898,
      "mae_dx": 0.008139009587466717,
      "mae_dy": 0.004951676353812218,
      "pose_mae_dtheta": 0.2460641711950302,
      "pose_mae_dx": 0.06537482142448425,
      "pose_mae_dy": 0.053586285561323166,
      "pose_rmse_dtheta": 0.4747946262359619,
      "pose_rmse_dx": 0.13585533201694489,
      "pose_rmse_dy": 0.1278945356607437,
      "pose_rmse_mean": 0.24618148803710938,
      "rmse_dtheta": 0.05128002166748047,
      "rmse_dx": 0.017550768330693245,
      "rmse_dy": 0.010576357133686543,
      "rmse_mean": 0.026469049975275993,
      "rotation_flip": 0.011288804933428764,
      "sparse_tokens": 19175.0,
      "step": 6171,
      "turn_loss": 0.2515018582344055,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 29522.0,
      "epoch": 0.2867496747816391,
      "grad_norm": 0.3788435757160187,
      "learning_rate": 4.853254751619019e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.03594522550702095,
      "mae_dx": 0.013184776529669762,
      "mae_dy": 0.005563037004321814,
      "pose_mae_dtheta": 0.28531259298324585,
      "pose_mae_dx": 0.10616393387317657,
      "pose_mae_dy": 0.05813935771584511,
      "pose_rmse_dtheta": 0.5182081460952759,
      "pose_rmse_dx": 0.22179974615573883,
      "pose_rmse_dy": 0.14257259666919708,
      "pose_rmse_mean": 0.2941935062408447,
      "rmse_dtheta": 0.05517541617155075,
      "rmse_dx": 0.025546513497829437,
      "rmse_dy": 0.011599442921578884,
      "rmse_mean": 0.030773792415857315,
      "rotation_flip": 0.017621144652366638,
      "sparse_tokens": 23323.0,
      "step": 6172,
      "turn_loss": 0.31999117136001587,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.2867961345474819,
      "grad_norm": 0.4083961248397827,
      "learning_rate": 4.8519331072155665e-06,
      "loss": 0.1136,
      "mae_dtheta": 0.034626223146915436,
      "mae_dx": 0.008877376094460487,
      "mae_dy": 0.009123332798480988,
      "pose_mae_dtheta": 0.24647162854671478,
      "pose_mae_dx": 0.07995764166116714,
      "pose_mae_dy": 0.11422866582870483,
      "pose_rmse_dtheta": 0.4589237868785858,
      "pose_rmse_dx": 0.15669964253902435,
      "pose_rmse_dy": 0.21515555679798126,
      "pose_rmse_mean": 0.27692633867263794,
      "rmse_dtheta": 0.052081067115068436,
      "rmse_dx": 0.020251069217920303,
      "rmse_dy": 0.01390440110117197,
      "rmse_mean": 0.028745513409376144,
      "rotation_flip": 0.02777777798473835,
      "sparse_tokens": 4856.0,
      "step": 6173,
      "turn_loss": 0.23883087933063507,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 14619.0,
      "epoch": 0.28684259431332465,
      "grad_norm": 0.5999100804328918,
      "learning_rate": 4.850611473166514e-06,
      "loss": 0.132,
      "mae_dtheta": 0.013604636304080486,
      "mae_dx": 0.005883364472538233,
      "mae_dy": 0.0013082692166790366,
      "pose_mae_dtheta": 0.0962797999382019,
      "pose_mae_dx": 0.05212941765785217,
      "pose_mae_dy": 0.02332196570932865,
      "pose_rmse_dtheta": 0.23161834478378296,
      "pose_rmse_dx": 0.20145000517368317,
      "pose_rmse_dy": 0.06074919179081917,
      "pose_rmse_mean": 0.16460585594177246,
      "rmse_dtheta": 0.030236124992370605,
      "rmse_dx": 0.01871926337480545,
      "rmse_dy": 0.002966277999803424,
      "rmse_mean": 0.01730722188949585,
      "rotation_flip": 0.00544959120452404,
      "sparse_tokens": 11728.0,
      "step": 6174,
      "turn_loss": 0.1452081799507141,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 10700.0,
      "epoch": 0.2868890540791674,
      "grad_norm": 0.5695372819900513,
      "learning_rate": 4.849289849564278e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.035130199044942856,
      "mae_dx": 0.01301644742488861,
      "mae_dy": 0.0059644849970936775,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5695372819900513,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 141.75904846191406,
      "model/head/act_norm_mean": 103.6335967092803,
      "model/head/act_norm_min": 74.01097106933594,
      "model/head/act_over_embed": 71.21797789163608,
      "model/head/grad_frac": 0.09398168325424194,
      "model/head/grad_norm": 0.053526073694229126,
      "model/head/grad_zero_frac": 0.00018243126396555454,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6903409090909091,
      "model/head/update_ratio": 0.0009142128983512521,
      "model/head/weight_delta": 9.016780853271484,
      "model/head/weight_delta_rel": 0.15818104147911072,
      "model/head/weight_norm": 58.548805236816406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4208027720451355,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4208027720451355,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4208027720451355,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2891796045670387,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07810281217098236,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04448246210813522,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014375494793057442,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9206361770629883,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0954262837767601,
      "model/modality_embedder.encoders.pose/weight_norm": 30.943256378173828,
      "model/modality_embedder/grad_frac": 0.07810281217098236,
      "model/modality_embedder/grad_norm": 0.04448246210813522,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0014375494793057442,
      "model/modality_embedder/weight_delta": 2.9206361770629883,
      "model/modality_embedder/weight_delta_rel": 0.0954262837767601,
      "model/modality_embedder/weight_norm": 30.943256378173828,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.15213012695312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.053979151635403,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.282745361328125,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.842910307757199,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08317330479621887,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0473702996969223,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001699803862720728,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3117427825927734,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08424130082130432,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.86809730529785,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.3429183959961,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.884338173400675,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.709822654724121,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.413540801457934,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08050428330898285,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04585019126534462,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015480922302231193,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.9300150871276855,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10149801522493362,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.61722183227539,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.63020324707031,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.570791621572873,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.318500518798828,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.57248739986781,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08014293015003204,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04564438760280609,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014927014708518982,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.1590802669525146,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10607600212097168,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.57837677001953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.24341583251953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.49770961099086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.917333602905273,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.896683482286292,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07798488438129425,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.044415298849344254,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014888877049088478,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.700040102005005,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09227455407381058,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.831193923950195,
      "model/normalizer/grad_frac": 0.286295086145401,
      "model/normalizer/grad_norm": 0.16305573284626007,
      "model/normalizer/grad_zero_frac": 0.00018907814228441566,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002077523386105895,
      "model/normalizer/weight_delta": 5.715892791748047,
      "model/normalizer/weight_delta_rel": 0.07361739128828049,
      "model/normalizer/weight_norm": 78.48562622070312,
      "pose_mae_dtheta": 0.2584432065486908,
      "pose_mae_dx": 0.08796557784080505,
      "pose_mae_dy": 0.07413086295127869,
      "pose_rmse_dtheta": 0.461647629737854,
      "pose_rmse_dx": 0.1958131045103073,
      "pose_rmse_dy": 0.1813506782054901,
      "pose_rmse_mean": 0.2796038091182709,
      "rmse_dtheta": 0.05388645455241203,
      "rmse_dx": 0.025004003196954727,
      "rmse_dy": 0.012500640004873276,
      "rmse_mean": 0.030463701114058495,
      "rotation_flip": 0.02259887009859085,
      "sparse_tokens": 8583.0,
      "step": 6175,
      "turn_loss": 0.2788156569004059,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2869355138450102,
      "grad_norm": 0.5689058899879456,
      "learning_rate": 4.8479682365012855e-06,
      "loss": 0.1537,
      "mae_dtheta": 0.014291401952505112,
      "mae_dx": 0.0025316355749964714,
      "mae_dy": 0.003175035584717989,
      "pose_mae_dtheta": 0.09913888573646545,
      "pose_mae_dx": 0.03185778111219406,
      "pose_mae_dy": 0.03320930153131485,
      "pose_rmse_dtheta": 0.25415298342704773,
      "pose_rmse_dx": 0.08569645136594772,
      "pose_rmse_dy": 0.07957148551940918,
      "pose_rmse_mean": 0.13980698585510254,
      "rmse_dtheta": 0.03002733178436756,
      "rmse_dx": 0.007393707055598497,
      "rmse_dy": 0.007427070289850235,
      "rmse_mean": 0.014949370175600052,
      "rotation_flip": 0.00501253129914403,
      "sparse_tokens": 32105.0,
      "step": 6176,
      "turn_loss": 0.09685686230659485,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.286981973610853,
      "grad_norm": 0.5314337015151978,
      "learning_rate": 4.846646634069957e-06,
      "loss": 0.1893,
      "mae_dtheta": 0.006431711837649345,
      "mae_dx": 0.0012233640300109982,
      "mae_dy": 0.0016432171687483788,
      "pose_mae_dtheta": 0.044306542724370956,
      "pose_mae_dx": 0.01584644429385662,
      "pose_mae_dy": 0.01916208676993847,
      "pose_rmse_dtheta": 0.07944203913211823,
      "pose_rmse_dx": 0.03446359559893608,
      "pose_rmse_dy": 0.04289442300796509,
      "pose_rmse_mean": 0.0522666871547699,
      "rmse_dtheta": 0.012905068695545197,
      "rmse_dx": 0.0034369330387562513,
      "rmse_dy": 0.0033331229351460934,
      "rmse_mean": 0.006558374967426062,
      "rotation_flip": 0.0055432370863854885,
      "sparse_tokens": 32137.0,
      "step": 6177,
      "turn_loss": 0.059134695678949356,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.28702843337669576,
      "grad_norm": 0.4340488910675049,
      "learning_rate": 4.84532504236271e-06,
      "loss": 0.121,
      "mae_dtheta": 0.008764331229031086,
      "mae_dx": 0.0012441136641427875,
      "mae_dy": 0.002499769441783428,
      "pose_mae_dtheta": 0.06101711094379425,
      "pose_mae_dx": 0.02073197439312935,
      "pose_mae_dy": 0.03188361972570419,
      "pose_rmse_dtheta": 0.11368813365697861,
      "pose_rmse_dx": 0.048825155943632126,
      "pose_rmse_dy": 0.06636307388544083,
      "pose_rmse_mean": 0.07629211992025375,
      "rmse_dtheta": 0.01673934794962406,
      "rmse_dx": 0.003359177615493536,
      "rmse_dy": 0.00495690805837512,
      "rmse_mean": 0.00835181213915348,
      "rotation_flip": 0.0033370412420481443,
      "sparse_tokens": 32057.0,
      "step": 6178,
      "turn_loss": 0.07353953272104263,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.28707489314253853,
      "grad_norm": 0.3387419879436493,
      "learning_rate": 4.844003461471967e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.0059528048150241375,
      "mae_dx": 0.0010233126813545823,
      "mae_dy": 0.0008717915625311434,
      "pose_mae_dtheta": 0.042304713279008865,
      "pose_mae_dx": 0.01009836234152317,
      "pose_mae_dy": 0.012161762453615665,
      "pose_rmse_dtheta": 0.18440304696559906,
      "pose_rmse_dx": 0.026613837108016014,
      "pose_rmse_dy": 0.03719639405608177,
      "pose_rmse_mean": 0.0827377587556839,
      "rmse_dtheta": 0.020540015771985054,
      "rmse_dx": 0.003139961278066039,
      "rmse_dy": 0.002226906130090356,
      "rmse_mean": 0.008635628037154675,
      "rotation_flip": 0.002453987719491124,
      "sparse_tokens": 32105.0,
      "step": 6179,
      "turn_loss": 0.052014678716659546,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16565.0,
      "epoch": 0.28712135290838137,
      "grad_norm": 0.524519681930542,
      "learning_rate": 4.842681891490144e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.029595186933875084,
      "mae_dx": 0.011892455630004406,
      "mae_dy": 0.005835514981299639,
      "pose_mae_dtheta": 0.21321779489517212,
      "pose_mae_dx": 0.08379742503166199,
      "pose_mae_dy": 0.06855053454637527,
      "pose_rmse_dtheta": 0.3945719003677368,
      "pose_rmse_dx": 0.19387927651405334,
      "pose_rmse_dy": 0.15819482505321503,
      "pose_rmse_mean": 0.248881995677948,
      "rmse_dtheta": 0.047632429748773575,
      "rmse_dx": 0.023534981533885002,
      "rmse_dy": 0.012260057032108307,
      "rmse_mean": 0.027809156104922295,
      "rotation_flip": 0.014326647855341434,
      "sparse_tokens": 14159.0,
      "step": 6180,
      "turn_loss": 0.2842899262905121,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.28716781267422414,
      "grad_norm": 0.6180384755134583,
      "learning_rate": 4.841360332509663e-06,
      "loss": 0.2045,
      "mae_dtheta": 0.010303490795195103,
      "mae_dx": 0.002588935662060976,
      "mae_dy": 0.002440893091261387,
      "pose_mae_dtheta": 0.07733215391635895,
      "pose_mae_dx": 0.018985744565725327,
      "pose_mae_dy": 0.02570352889597416,
      "pose_rmse_dtheta": 0.20598407089710236,
      "pose_rmse_dx": 0.052287507802248,
      "pose_rmse_dy": 0.07701981067657471,
      "pose_rmse_mean": 0.11176379770040512,
      "rmse_dtheta": 0.026620984077453613,
      "rmse_dx": 0.007762914523482323,
      "rmse_dy": 0.007881754077970982,
      "rmse_mean": 0.014088551513850689,
      "rotation_flip": 0.004997728392481804,
      "sparse_tokens": 32137.0,
      "step": 6181,
      "turn_loss": 0.11311189830303192,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2872142724400669,
      "grad_norm": 0.6118588447570801,
      "learning_rate": 4.840038784622937e-06,
      "loss": 0.1698,
      "mae_dtheta": 0.01119421236217022,
      "mae_dx": 0.0015526553615927696,
      "mae_dy": 0.0017849639989435673,
      "pose_mae_dtheta": 0.07938475161790848,
      "pose_mae_dx": 0.017702413722872734,
      "pose_mae_dy": 0.024769792333245277,
      "pose_rmse_dtheta": 0.25159937143325806,
      "pose_rmse_dx": 0.05283127725124359,
      "pose_rmse_dy": 0.07688914239406586,
      "pose_rmse_mean": 0.12710660696029663,
      "rmse_dtheta": 0.028696242719888687,
      "rmse_dx": 0.005233002360910177,
      "rmse_dy": 0.004558706656098366,
      "rmse_mean": 0.012829316779971123,
      "rotation_flip": 0.0038591413758695126,
      "sparse_tokens": 32105.0,
      "step": 6182,
      "turn_loss": 0.0843021348118782,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.2872607322059097,
      "grad_norm": 0.5566504597663879,
      "learning_rate": 4.838717247922385e-06,
      "loss": 0.1489,
      "mae_dtheta": 0.03257635980844498,
      "mae_dx": 0.013418251648545265,
      "mae_dy": 0.009526954963803291,
      "pose_mae_dtheta": 0.22707436978816986,
      "pose_mae_dx": 0.109210304915905,
      "pose_mae_dy": 0.13874799013137817,
      "pose_rmse_dtheta": 0.353491872549057,
      "pose_rmse_dx": 0.20928117632865906,
      "pose_rmse_dy": 0.24532194435596466,
      "pose_rmse_mean": 0.26936501264572144,
      "rmse_dtheta": 0.046985529363155365,
      "rmse_dx": 0.025180010125041008,
      "rmse_dy": 0.01673395372927189,
      "rmse_mean": 0.029633164405822754,
      "rotation_flip": 0.006896551698446274,
      "sparse_tokens": 7058.0,
      "step": 6183,
      "turn_loss": 0.36417412757873535,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.2873071919717525,
      "grad_norm": 0.36545032262802124,
      "learning_rate": 4.837395722500424e-06,
      "loss": 0.1021,
      "mae_dtheta": 0.030815638601779938,
      "mae_dx": 0.010859867557883263,
      "mae_dy": 0.008806083351373672,
      "pose_mae_dtheta": 0.2200482040643692,
      "pose_mae_dx": 0.09108185023069382,
      "pose_mae_dy": 0.03546144813299179,
      "pose_rmse_dtheta": 0.3791641592979431,
      "pose_rmse_dx": 0.18879759311676025,
      "pose_rmse_dy": 0.08410383015871048,
      "pose_rmse_mean": 0.21735519170761108,
      "rmse_dtheta": 0.050806645303964615,
      "rmse_dx": 0.02108248695731163,
      "rmse_dy": 0.018259141594171524,
      "rmse_mean": 0.03004942461848259,
      "rotation_flip": 0.009216589853167534,
      "sparse_tokens": 3665.0,
      "step": 6184,
      "turn_loss": 0.35224252939224243,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.28735365173759525,
      "grad_norm": 0.47151830792427063,
      "learning_rate": 4.836074208449466e-06,
      "loss": 0.1299,
      "mae_dtheta": 0.012111132964491844,
      "mae_dx": 0.0015308621805161238,
      "mae_dy": 0.00260751461610198,
      "pose_mae_dtheta": 0.08292830735445023,
      "pose_mae_dx": 0.021462466567754745,
      "pose_mae_dy": 0.03253593295812607,
      "pose_rmse_dtheta": 0.21466320753097534,
      "pose_rmse_dx": 0.049976713955402374,
      "pose_rmse_dy": 0.11315923929214478,
      "pose_rmse_mean": 0.12593305110931396,
      "rmse_dtheta": 0.026804862543940544,
      "rmse_dx": 0.004024353809654713,
      "rmse_dy": 0.006286672782152891,
      "rmse_mean": 0.012371963821351528,
      "rotation_flip": 0.006088825408369303,
      "sparse_tokens": 32153.0,
      "step": 6185,
      "turn_loss": 0.09322670102119446,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.287400111503438,
      "grad_norm": 0.811520516872406,
      "learning_rate": 4.834752705861927e-06,
      "loss": 0.2644,
      "mae_dtheta": 0.03945566341280937,
      "mae_dx": 0.009551787748932838,
      "mae_dy": 0.0029819572810083628,
      "pose_mae_dtheta": 0.3216239809989929,
      "pose_mae_dx": 0.07757684588432312,
      "pose_mae_dy": 0.04238554462790489,
      "pose_rmse_dtheta": 0.5607969164848328,
      "pose_rmse_dx": 0.16619624197483063,
      "pose_rmse_dy": 0.09384231269359589,
      "pose_rmse_mean": 0.273611843585968,
      "rmse_dtheta": 0.0587909035384655,
      "rmse_dx": 0.019295264035463333,
      "rmse_dy": 0.0055265408009290695,
      "rmse_mean": 0.02787090465426445,
      "rotation_flip": 0.009842519648373127,
      "sparse_tokens": 9371.0,
      "step": 6186,
      "turn_loss": 0.22067393362522125,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 31046.0,
      "epoch": 0.2874465712692808,
      "grad_norm": 0.46387016773223877,
      "learning_rate": 4.83343121483022e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.03231494128704071,
      "mae_dx": 0.011290164664387703,
      "mae_dy": 0.007072728592902422,
      "pose_mae_dtheta": 0.255956768989563,
      "pose_mae_dx": 0.10589579492807388,
      "pose_mae_dy": 0.11234890669584274,
      "pose_rmse_dtheta": 0.4333423674106598,
      "pose_rmse_dx": 0.2227950096130371,
      "pose_rmse_dy": 0.213662788271904,
      "pose_rmse_mean": 0.28993338346481323,
      "rmse_dtheta": 0.04804334416985512,
      "rmse_dx": 0.024106817319989204,
      "rmse_dy": 0.011905068531632423,
      "rmse_mean": 0.028018411248922348,
      "rotation_flip": 0.011278195306658745,
      "sparse_tokens": 24600.0,
      "step": 6187,
      "turn_loss": 0.21868354082107544,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2874930310351236,
      "grad_norm": 0.37890946865081787,
      "learning_rate": 4.8321097354467575e-06,
      "loss": 0.0543,
      "mae_dtheta": 0.009808706119656563,
      "mae_dx": 0.0014384061796590686,
      "mae_dy": 0.0019511390710249543,
      "pose_mae_dtheta": 0.06873062998056412,
      "pose_mae_dx": 0.01899627223610878,
      "pose_mae_dy": 0.025836128741502762,
      "pose_rmse_dtheta": 0.1963600218296051,
      "pose_rmse_dx": 0.04934493824839592,
      "pose_rmse_dy": 0.056685514748096466,
      "pose_rmse_mean": 0.10079683363437653,
      "rmse_dtheta": 0.023642772808670998,
      "rmse_dx": 0.004841512534767389,
      "rmse_dy": 0.0042953938245773315,
      "rmse_mean": 0.010926559567451477,
      "rotation_flip": 0.004046762362122536,
      "sparse_tokens": 32057.0,
      "step": 6188,
      "turn_loss": 0.06969546526670456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35254.0,
      "epoch": 0.28753949080096636,
      "grad_norm": 0.5764880776405334,
      "learning_rate": 4.830788267803952e-06,
      "loss": 0.1663,
      "mae_dtheta": 0.030014213174581528,
      "mae_dx": 0.012020312249660492,
      "mae_dy": 0.0058416035026311874,
      "pose_mae_dtheta": 0.2457723617553711,
      "pose_mae_dx": 0.10536681115627289,
      "pose_mae_dy": 0.07541797310113907,
      "pose_rmse_dtheta": 0.4174000322818756,
      "pose_rmse_dx": 0.21906574070453644,
      "pose_rmse_dy": 0.18557341396808624,
      "pose_rmse_mean": 0.27401307225227356,
      "rmse_dtheta": 0.04612860456109047,
      "rmse_dx": 0.023845624178647995,
      "rmse_dy": 0.012555528432130814,
      "rmse_mean": 0.027509918436408043,
      "rotation_flip": 0.016861218959093094,
      "sparse_tokens": 29065.0,
      "step": 6189,
      "turn_loss": 0.28307676315307617,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.28758595056680913,
      "grad_norm": 0.37311530113220215,
      "learning_rate": 4.829466811994212e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.03564330190420151,
      "mae_dx": 0.009063360281288624,
      "mae_dy": 0.002904640045017004,
      "pose_mae_dtheta": 0.2812107801437378,
      "pose_mae_dx": 0.08264423161745071,
      "pose_mae_dy": 0.03403390944004059,
      "pose_rmse_dtheta": 0.5142141580581665,
      "pose_rmse_dx": 0.15681371092796326,
      "pose_rmse_dy": 0.07546563446521759,
      "pose_rmse_mean": 0.24883118271827698,
      "rmse_dtheta": 0.0529734268784523,
      "rmse_dx": 0.018835362046957016,
      "rmse_dy": 0.006161153316497803,
      "rmse_mean": 0.02598997950553894,
      "rotation_flip": 0.019417475908994675,
      "sparse_tokens": 6727.0,
      "step": 6190,
      "turn_loss": 0.23973219096660614,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 27903.0,
      "epoch": 0.2876324103326519,
      "grad_norm": 0.3126598000526428,
      "learning_rate": 4.8281453681099515e-06,
      "loss": 0.0943,
      "mae_dtheta": 0.03440804407000542,
      "mae_dx": 0.008512134663760662,
      "mae_dy": 0.00757137406617403,
      "pose_mae_dtheta": 0.24039769172668457,
      "pose_mae_dx": 0.0690808892250061,
      "pose_mae_dy": 0.09319181740283966,
      "pose_rmse_dtheta": 0.4095610976219177,
      "pose_rmse_dx": 0.1501389890909195,
      "pose_rmse_dy": 0.2055322825908661,
      "pose_rmse_mean": 0.25507745146751404,
      "rmse_dtheta": 0.05112319812178612,
      "rmse_dx": 0.019281055778265,
      "rmse_dy": 0.014652101323008537,
      "rmse_mean": 0.028352119028568268,
      "rotation_flip": 0.01743745245039463,
      "sparse_tokens": 22439.0,
      "step": 6191,
      "turn_loss": 0.30264905095100403,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.2876788700984947,
      "grad_norm": 0.4256075918674469,
      "learning_rate": 4.826823936243575e-06,
      "loss": 0.0857,
      "mae_dtheta": 0.04088199883699417,
      "mae_dx": 0.015622727572917938,
      "mae_dy": 0.009810942225158215,
      "pose_mae_dtheta": 0.328525185585022,
      "pose_mae_dx": 0.11159304529428482,
      "pose_mae_dy": 0.11117926239967346,
      "pose_rmse_dtheta": 0.6107600927352905,
      "pose_rmse_dx": 0.25353431701660156,
      "pose_rmse_dy": 0.24202315509319305,
      "pose_rmse_mean": 0.3687725067138672,
      "rmse_dtheta": 0.061640795320272446,
      "rmse_dx": 0.02864864654839039,
      "rmse_dy": 0.017970465123653412,
      "rmse_mean": 0.036086637526750565,
      "rotation_flip": 0.018918918445706367,
      "sparse_tokens": 6218.0,
      "step": 6192,
      "turn_loss": 0.3401504456996918,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.28772532986433746,
      "grad_norm": 0.4996178150177002,
      "learning_rate": 4.825502516487497e-06,
      "loss": 0.0946,
      "mae_dtheta": 0.014627990312874317,
      "mae_dx": 0.0042591821402311325,
      "mae_dy": 0.00633223494514823,
      "pose_mae_dtheta": 0.10845839977264404,
      "pose_mae_dx": 0.04168587177991867,
      "pose_mae_dy": 0.06060542166233063,
      "pose_rmse_dtheta": 0.21965987980365753,
      "pose_rmse_dx": 0.10849524289369583,
      "pose_rmse_dy": 0.172026127576828,
      "pose_rmse_mean": 0.16672709584236145,
      "rmse_dtheta": 0.026413021609187126,
      "rmse_dx": 0.01153174601495266,
      "rmse_dy": 0.015249701216816902,
      "rmse_mean": 0.01773149147629738,
      "rotation_flip": 0.0037645448464900255,
      "sparse_tokens": 32057.0,
      "step": 6193,
      "turn_loss": 0.15685415267944336,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.28777178963018024,
      "grad_norm": 0.38803836703300476,
      "learning_rate": 4.824181108934118e-06,
      "loss": 0.0819,
      "mae_dtheta": 0.008920160122215748,
      "mae_dx": 0.001461837557144463,
      "mae_dy": 0.0012803036952391267,
      "pose_mae_dtheta": 0.06094327196478844,
      "pose_mae_dx": 0.01483938004821539,
      "pose_mae_dy": 0.01795290596783161,
      "pose_rmse_dtheta": 0.19541974365711212,
      "pose_rmse_dx": 0.04436226934194565,
      "pose_rmse_dy": 0.04241194948554039,
      "pose_rmse_mean": 0.09406465291976929,
      "rmse_dtheta": 0.02431502193212509,
      "rmse_dx": 0.005340032745152712,
      "rmse_dy": 0.003489880356937647,
      "rmse_mean": 0.011048312298953533,
      "rotation_flip": 0.004950494971126318,
      "sparse_tokens": 32105.0,
      "step": 6194,
      "turn_loss": 0.06596928089857101,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.287818249396023,
      "grad_norm": 0.504756510257721,
      "learning_rate": 4.82285971367585e-06,
      "loss": 0.1356,
      "mae_dtheta": 0.035090215504169464,
      "mae_dx": 0.013773311860859394,
      "mae_dy": 0.006021188572049141,
      "pose_mae_dtheta": 0.22617895901203156,
      "pose_mae_dx": 0.11304894089698792,
      "pose_mae_dy": 0.061428844928741455,
      "pose_rmse_dtheta": 0.38415515422821045,
      "pose_rmse_dx": 0.21990402042865753,
      "pose_rmse_dy": 0.1495182067155838,
      "pose_rmse_mean": 0.25119245052337646,
      "rmse_dtheta": 0.05120173841714859,
      "rmse_dx": 0.026246676221489906,
      "rmse_dy": 0.012677399441599846,
      "rmse_mean": 0.03004193864762783,
      "rotation_flip": 0.007692307699471712,
      "sparse_tokens": 10931.0,
      "step": 6195,
      "turn_loss": 0.3479926884174347,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 41410.0,
      "epoch": 0.28786470916186585,
      "grad_norm": 0.5293616652488708,
      "learning_rate": 4.821538330805098e-06,
      "loss": 0.1297,
      "mae_dtheta": 0.03581841662526131,
      "mae_dx": 0.009660378098487854,
      "mae_dy": 0.003276652889326215,
      "pose_mae_dtheta": 0.3113184869289398,
      "pose_mae_dx": 0.0785442516207695,
      "pose_mae_dy": 0.037366192787885666,
      "pose_rmse_dtheta": 0.5638347864151001,
      "pose_rmse_dx": 0.18866388499736786,
      "pose_rmse_dy": 0.0935271605849266,
      "pose_rmse_mean": 0.2820086181163788,
      "rmse_dtheta": 0.05496734753251076,
      "rmse_dx": 0.020641392096877098,
      "rmse_dy": 0.006486298982053995,
      "rmse_mean": 0.02736501209437847,
      "rotation_flip": 0.012799999676644802,
      "sparse_tokens": 30010.0,
      "step": 6196,
      "turn_loss": 0.25335636734962463,
      "turns": 128.0,
      "turns_per_sample": 128.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.2879111689277086,
      "grad_norm": 0.5943787693977356,
      "learning_rate": 4.820216960414265e-06,
      "loss": 0.1776,
      "mae_dtheta": 0.03330760449171066,
      "mae_dx": 0.008372793905436993,
      "mae_dy": 0.003983030095696449,
      "pose_mae_dtheta": 0.2295646220445633,
      "pose_mae_dx": 0.07087833434343338,
      "pose_mae_dy": 0.027863886207342148,
      "pose_rmse_dtheta": 0.3794701397418976,
      "pose_rmse_dx": 0.17636513710021973,
      "pose_rmse_dy": 0.07450933754444122,
      "pose_rmse_mean": 0.21011486649513245,
      "rmse_dtheta": 0.05101063475012779,
      "rmse_dx": 0.01885315589606762,
      "rmse_dy": 0.00938456878066063,
      "rmse_mean": 0.026416119188070297,
      "rotation_flip": 0.014477766118943691,
      "sparse_tokens": 14966.0,
      "step": 6197,
      "turn_loss": 0.2630159556865692,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 30818.0,
      "epoch": 0.2879576286935514,
      "grad_norm": 0.5569180846214294,
      "learning_rate": 4.818895602595759e-06,
      "loss": 0.101,
      "mae_dtheta": 0.0278842281550169,
      "mae_dx": 0.014562529511749744,
      "mae_dy": 0.004661091137677431,
      "pose_mae_dtheta": 0.2101430743932724,
      "pose_mae_dx": 0.11385351419448853,
      "pose_mae_dy": 0.06626109778881073,
      "pose_rmse_dtheta": 0.3958599865436554,
      "pose_rmse_dx": 0.2772788107395172,
      "pose_rmse_dy": 0.15087394416332245,
      "pose_rmse_mean": 0.27467092871665955,
      "rmse_dtheta": 0.04586421325802803,
      "rmse_dx": 0.029545577242970467,
      "rmse_dy": 0.010993815958499908,
      "rmse_mean": 0.02880120277404785,
      "rotation_flip": 0.018469657748937607,
      "sparse_tokens": 25400.0,
      "step": 6198,
      "turn_loss": 0.1714179962873459,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 16241.0,
      "epoch": 0.2880040884593942,
      "grad_norm": 0.48510846495628357,
      "learning_rate": 4.817574257441978e-06,
      "loss": 0.1541,
      "mae_dtheta": 0.03679117187857628,
      "mae_dx": 0.010070865042507648,
      "mae_dy": 0.0068425401113927364,
      "pose_mae_dtheta": 0.26137199997901917,
      "pose_mae_dx": 0.08457500487565994,
      "pose_mae_dy": 0.0790272131562233,
      "pose_rmse_dtheta": 0.4781002700328827,
      "pose_rmse_dx": 0.1914166659116745,
      "pose_rmse_dy": 0.23399235308170319,
      "pose_rmse_mean": 0.301169753074646,
      "rmse_dtheta": 0.055207084864377975,
      "rmse_dx": 0.021833164617419243,
      "rmse_dy": 0.014783496968448162,
      "rmse_mean": 0.030607914552092552,
      "rotation_flip": 0.01678321696817875,
      "sparse_tokens": 13728.0,
      "step": 6199,
      "turn_loss": 0.28494665026664734,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.28805054822523696,
      "grad_norm": 0.4694916009902954,
      "learning_rate": 4.816252925045329e-06,
      "loss": 0.1654,
      "mae_dtheta": 0.03977625444531441,
      "mae_dx": 0.018807880580425262,
      "mae_dy": 0.007496074307709932,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.46949154138565063,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.25387573242188,
      "model/head/act_norm_mean": 97.3165967987805,
      "model/head/act_norm_min": 64.98587036132812,
      "model/head/act_over_embed": 66.87687641245569,
      "model/head/grad_frac": 0.12510265409946442,
      "model/head/grad_norm": 0.05873464047908783,
      "model/head/grad_zero_frac": 0.00020051575847901404,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6915967987804879,
      "model/head/update_ratio": 0.0010031270794570446,
      "model/head/weight_delta": 9.02955150604248,
      "model/head/weight_delta_rel": 0.15840508043766022,
      "model/head/weight_norm": 58.551544189453125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.420915812253952,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42087831951323007,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4208378493785858,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28923152149439985,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07571875303983688,
      "model/modality_embedder.encoders.pose/grad_norm": 0.035549312829971313,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011488356394693255,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9237704277038574,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09552869200706482,
      "model/modality_embedder.encoders.pose/weight_norm": 30.943775177001953,
      "model/modality_embedder/grad_frac": 0.07571875303983688,
      "model/modality_embedder/grad_norm": 0.035549312829971313,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0011488356394693255,
      "model/modality_embedder/weight_delta": 2.9237704277038574,
      "model/modality_embedder/weight_delta_rel": 0.09552869200706482,
      "model/modality_embedder/weight_norm": 30.943775177001953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.4695816040039,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.5143637485482,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.230666160583496,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.472081550796673,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08401293307542801,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03944336250424385,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014153143856674433,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.31707763671875,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08443570882081985,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.868976593017578,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.66527557373047,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.328952223674023,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.926017761230469,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.031874377200598,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08179255574941635,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03840091452002525,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012964949710294604,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.9367871284484863,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10173260420560837,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.6190242767334,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.24478149414062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.965040347948122,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.163718223571777,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.156209453500107,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08265150338411331,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.038804180920124054,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012689332943409681,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.166597366333008,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10632841289043427,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.580158233642578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 75.96709442138672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.905412190282618,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.180665016174316,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.48965114959977,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07801111042499542,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03662555664777756,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00032783247297629714,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012276900233700871,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7065513134002686,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0924970805644989,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.832901000976562,
      "model/normalizer/grad_frac": 0.2847710847854614,
      "model/normalizer/grad_norm": 0.13369761407375336,
      "model/normalizer/grad_zero_frac": 0.00026352767599746585,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001703424728475511,
      "model/normalizer/weight_delta": 5.729362964630127,
      "model/normalizer/weight_delta_rel": 0.07379087805747986,
      "model/normalizer/weight_norm": 78.48754119873047,
      "pose_mae_dtheta": 0.3001430034637451,
      "pose_mae_dx": 0.14300298690795898,
      "pose_mae_dy": 0.07109441608190536,
      "pose_rmse_dtheta": 0.4744347929954529,
      "pose_rmse_dx": 0.29454654455184937,
      "pose_rmse_dy": 0.1635570377111435,
      "pose_rmse_mean": 0.31084614992141724,
      "rmse_dtheta": 0.05642712116241455,
      "rmse_dx": 0.032962992787361145,
      "rmse_dy": 0.014526145532727242,
      "rmse_mean": 0.03463875502347946,
      "rotation_flip": 0.019519519060850143,
      "sparse_tokens": 10295.0,
      "step": 6200,
      "turn_loss": 0.3828897774219513,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "epoch": 0.28805054822523696,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3111988306045532,
      "eval_objectnav_nopose_mae_dtheta": 0.041187990456819534,
      "eval_objectnav_nopose_mae_dx": 0.013480388559401035,
      "eval_objectnav_nopose_mae_dy": 0.004799462389200926,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3344556391239166,
      "eval_objectnav_nopose_pose_mae_dx": 0.10890066623687744,
      "eval_objectnav_nopose_pose_mae_dy": 0.053642403334379196,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5618326663970947,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2388988733291626,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12617965042591095,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3089703917503357,
      "eval_objectnav_nopose_rmse_dtheta": 0.05929062142968178,
      "eval_objectnav_nopose_rmse_dx": 0.026381587609648705,
      "eval_objectnav_nopose_rmse_dy": 0.009951014071702957,
      "eval_objectnav_nopose_rmse_mean": 0.031874410808086395,
      "eval_objectnav_nopose_rotation_flip": 0.015268072485923767,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3111988306045532,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 6200
    },
    {
      "epoch": 0.28805054822523696,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2803381085395813,
      "eval_objectnav_pose_mae_dtheta": 0.0358702726662159,
      "eval_objectnav_pose_mae_dx": 0.011800477281212807,
      "eval_objectnav_pose_mae_dy": 0.004406027030199766,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27311787009239197,
      "eval_objectnav_pose_pose_mae_dx": 0.09217633306980133,
      "eval_objectnav_pose_pose_mae_dy": 0.04751630872488022,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4772128164768219,
      "eval_objectnav_pose_pose_rmse_dx": 0.21368078887462616,
      "eval_objectnav_pose_pose_rmse_dy": 0.1173219159245491,
      "eval_objectnav_pose_pose_rmse_mean": 0.26940518617630005,
      "eval_objectnav_pose_rmse_dtheta": 0.053814176470041275,
      "eval_objectnav_pose_rmse_dx": 0.02440473809838295,
      "eval_objectnav_pose_rmse_dy": 0.009260093793272972,
      "eval_objectnav_pose_rmse_mean": 0.0291596706956625,
      "eval_objectnav_pose_rotation_flip": 0.014800109900534153,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2803381085395813,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 6200
    },
    {
      "epoch": 0.28805054822523696,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09318927675485611,
      "eval_pointnav_mae_dtheta": 0.010655704885721207,
      "eval_pointnav_mae_dx": 0.002487418707460165,
      "eval_pointnav_mae_dy": 0.0025409385561943054,
      "eval_pointnav_pose_mae_dtheta": 0.07412727177143097,
      "eval_pointnav_pose_mae_dx": 0.02730342000722885,
      "eval_pointnav_pose_mae_dy": 0.027008015662431717,
      "eval_pointnav_pose_rmse_dtheta": 0.2074783444404602,
      "eval_pointnav_pose_rmse_dx": 0.0817471593618393,
      "eval_pointnav_pose_rmse_dy": 0.07712419331073761,
      "eval_pointnav_pose_rmse_mean": 0.1221165657043457,
      "eval_pointnav_rmse_dtheta": 0.025832315906882286,
      "eval_pointnav_rmse_dx": 0.007664084434509277,
      "eval_pointnav_rmse_dy": 0.006895094178617001,
      "eval_pointnav_rmse_mean": 0.013463832437992096,
      "eval_pointnav_rotation_flip": 0.005072349216789007,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09318927675485611,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 6200
    },
    {
      "epoch": 0.28805054822523696,
      "eval_loss": 0.2282420719663302,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3111988306045532,
      "eval_objectnav_nopose_mae_dtheta": 0.041187990456819534,
      "eval_objectnav_nopose_mae_dx": 0.013480388559401035,
      "eval_objectnav_nopose_mae_dy": 0.004799462389200926,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3344556391239166,
      "eval_objectnav_nopose_pose_mae_dx": 0.10890066623687744,
      "eval_objectnav_nopose_pose_mae_dy": 0.053642403334379196,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5618326663970947,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2388988733291626,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12617965042591095,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3089703917503357,
      "eval_objectnav_nopose_rmse_dtheta": 0.05929062142968178,
      "eval_objectnav_nopose_rmse_dx": 0.026381587609648705,
      "eval_objectnav_nopose_rmse_dy": 0.009951014071702957,
      "eval_objectnav_nopose_rmse_mean": 0.031874410808086395,
      "eval_objectnav_nopose_rotation_flip": 0.015268072485923767,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3111988306045532,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2803381085395813,
      "eval_objectnav_pose_mae_dtheta": 0.0358702726662159,
      "eval_objectnav_pose_mae_dx": 0.011800477281212807,
      "eval_objectnav_pose_mae_dy": 0.004406027030199766,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27311787009239197,
      "eval_objectnav_pose_pose_mae_dx": 0.09217633306980133,
      "eval_objectnav_pose_pose_mae_dy": 0.04751630872488022,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4772128164768219,
      "eval_objectnav_pose_pose_rmse_dx": 0.21368078887462616,
      "eval_objectnav_pose_pose_rmse_dy": 0.1173219159245491,
      "eval_objectnav_pose_pose_rmse_mean": 0.26940518617630005,
      "eval_objectnav_pose_rmse_dtheta": 0.053814176470041275,
      "eval_objectnav_pose_rmse_dx": 0.02440473809838295,
      "eval_objectnav_pose_rmse_dy": 0.009260093793272972,
      "eval_objectnav_pose_rmse_mean": 0.0291596706956625,
      "eval_objectnav_pose_rotation_flip": 0.014800109900534153,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2803381085395813,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09318927675485611,
      "eval_pointnav_mae_dtheta": 0.010655704885721207,
      "eval_pointnav_mae_dx": 0.002487418707460165,
      "eval_pointnav_mae_dy": 0.0025409385561943054,
      "eval_pointnav_pose_mae_dtheta": 0.07412727177143097,
      "eval_pointnav_pose_mae_dx": 0.02730342000722885,
      "eval_pointnav_pose_mae_dy": 0.027008015662431717,
      "eval_pointnav_pose_rmse_dtheta": 0.2074783444404602,
      "eval_pointnav_pose_rmse_dx": 0.0817471593618393,
      "eval_pointnav_pose_rmse_dy": 0.07712419331073761,
      "eval_pointnav_pose_rmse_mean": 0.1221165657043457,
      "eval_pointnav_rmse_dtheta": 0.025832315906882286,
      "eval_pointnav_rmse_dx": 0.007664084434509277,
      "eval_pointnav_rmse_dy": 0.006895094178617001,
      "eval_pointnav_rmse_mean": 0.013463832437992096,
      "eval_pointnav_rotation_flip": 0.005072349216789007,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09318927675485611,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 6200
    },
    {
      "dense_tokens": 37198.0,
      "epoch": 0.28809700799107973,
      "grad_norm": 0.47678881883621216,
      "learning_rate": 4.81493160549821e-06,
      "loss": 0.1962,
      "mae_dtheta": 0.03828718140721321,
      "mae_dx": 0.014289461076259613,
      "mae_dy": 0.004839906468987465,
      "pose_mae_dtheta": 0.3320804536342621,
      "pose_mae_dx": 0.11384200304746628,
      "pose_mae_dy": 0.06321045011281967,
      "pose_rmse_dtheta": 0.5673149824142456,
      "pose_rmse_dx": 0.248879075050354,
      "pose_rmse_dy": 0.1578027307987213,
      "pose_rmse_mean": 0.3246656060218811,
      "rmse_dtheta": 0.05678192526102066,
      "rmse_dx": 0.02756688930094242,
      "rmse_dy": 0.010397449135780334,
      "rmse_mean": 0.03158208727836609,
      "rotation_flip": 0.013673088513314724,
      "sparse_tokens": 26590.0,
      "step": 6201,
      "turn_loss": 0.27556973695755005,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2881434677569225,
      "grad_norm": 0.46972256898880005,
      "learning_rate": 4.813610298893024e-06,
      "loss": 0.1415,
      "mae_dtheta": 0.009823473170399666,
      "mae_dx": 0.0027186337392777205,
      "mae_dy": 0.003517670789733529,
      "pose_mae_dtheta": 0.06625185906887054,
      "pose_mae_dx": 0.029758505523204803,
      "pose_mae_dy": 0.026522107422351837,
      "pose_rmse_dtheta": 0.15364426374435425,
      "pose_rmse_dx": 0.07795260101556778,
      "pose_rmse_dy": 0.0584540069103241,
      "pose_rmse_mean": 0.09668362140655518,
      "rmse_dtheta": 0.021584929898381233,
      "rmse_dx": 0.006918707862496376,
      "rmse_dy": 0.007857474498450756,
      "rmse_mean": 0.01212037168443203,
      "rotation_flip": 0.005526897497475147,
      "sparse_tokens": 32137.0,
      "step": 6202,
      "turn_loss": 0.10524944216012955,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2946.0,
      "epoch": 0.2881899275227653,
      "grad_norm": 0.46095770597457886,
      "learning_rate": 4.81228900532217e-06,
      "loss": 0.0908,
      "mae_dtheta": 0.04369675740599632,
      "mae_dx": 0.009773422963917255,
      "mae_dy": 0.002621816471219063,
      "pose_mae_dtheta": 0.43052130937576294,
      "pose_mae_dx": 0.06065153703093529,
      "pose_mae_dy": 0.0349266417324543,
      "pose_rmse_dtheta": 0.7261592745780945,
      "pose_rmse_dx": 0.16749633848667145,
      "pose_rmse_dy": 0.09069135040044785,
      "pose_rmse_mean": 0.32811564207077026,
      "rmse_dtheta": 0.06688590347766876,
      "rmse_dx": 0.023784829303622246,
      "rmse_dy": 0.0067191701382398605,
      "rmse_mean": 0.032463304698467255,
      "rotation_flip": 0.0,
      "sparse_tokens": 2546.0,
      "step": 6203,
      "turn_loss": 0.33739444613456726,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.28823638728860806,
      "grad_norm": 0.5230433940887451,
      "learning_rate": 4.810967724878046e-06,
      "loss": 0.1686,
      "mae_dtheta": 0.008337823674082756,
      "mae_dx": 0.00155262544285506,
      "mae_dy": 0.002050392795354128,
      "pose_mae_dtheta": 0.05926034227013588,
      "pose_mae_dx": 0.018053360283374786,
      "pose_mae_dy": 0.023849651217460632,
      "pose_rmse_dtheta": 0.16660663485527039,
      "pose_rmse_dx": 0.05588731914758682,
      "pose_rmse_dy": 0.06666074693202972,
      "pose_rmse_mean": 0.09638490527868271,
      "rmse_dtheta": 0.02033296413719654,
      "rmse_dx": 0.005615417845547199,
      "rmse_dy": 0.006175453774631023,
      "rmse_mean": 0.010707946494221687,
      "rotation_flip": 0.0016685206210240722,
      "sparse_tokens": 32041.0,
      "step": 6204,
      "turn_loss": 0.06650110334157944,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.28828284705445084,
      "grad_norm": 0.8584495186805725,
      "learning_rate": 4.809646457653051e-06,
      "loss": 0.1815,
      "mae_dtheta": 0.028085526078939438,
      "mae_dx": 0.01847134344279766,
      "mae_dy": 0.007845439948141575,
      "pose_mae_dtheta": 0.16997940838336945,
      "pose_mae_dx": 0.13379302620887756,
      "pose_mae_dy": 0.11016128957271576,
      "pose_rmse_dtheta": 0.2657887637615204,
      "pose_rmse_dx": 0.2611527740955353,
      "pose_rmse_dy": 0.17928104102611542,
      "pose_rmse_mean": 0.2354075312614441,
      "rmse_dtheta": 0.04089721292257309,
      "rmse_dx": 0.03201786056160927,
      "rmse_dy": 0.011458148248493671,
      "rmse_mean": 0.028124410659074783,
      "rotation_flip": 0.027863776311278343,
      "sparse_tokens": 5939.0,
      "step": 6205,
      "turn_loss": 0.3194459080696106,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2883293068202936,
      "grad_norm": 0.38433340191841125,
      "learning_rate": 4.808325203739581e-06,
      "loss": 0.1091,
      "mae_dtheta": 0.01166725903749466,
      "mae_dx": 0.0012176184682175517,
      "mae_dy": 0.0023682673927396536,
      "pose_mae_dtheta": 0.07099971175193787,
      "pose_mae_dx": 0.021623093634843826,
      "pose_mae_dy": 0.03119734115898609,
      "pose_rmse_dtheta": 0.1797170341014862,
      "pose_rmse_dx": 0.058964066207408905,
      "pose_rmse_dy": 0.06712758541107178,
      "pose_rmse_mean": 0.1019362360239029,
      "rmse_dtheta": 0.02293824777007103,
      "rmse_dx": 0.0033746762201189995,
      "rmse_dy": 0.004622690845280886,
      "rmse_mean": 0.010311871767044067,
      "rotation_flip": 0.004952129442244768,
      "sparse_tokens": 32089.0,
      "step": 6206,
      "turn_loss": 0.09088334441184998,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20710.0,
      "epoch": 0.2883757665861364,
      "grad_norm": 0.44707778096199036,
      "learning_rate": 4.807003963230033e-06,
      "loss": 0.1766,
      "mae_dtheta": 0.034577615559101105,
      "mae_dx": 0.014204725623130798,
      "mae_dy": 0.004633751697838306,
      "pose_mae_dtheta": 0.3059259355068207,
      "pose_mae_dx": 0.10518641769886017,
      "pose_mae_dy": 0.07303568720817566,
      "pose_rmse_dtheta": 0.47844088077545166,
      "pose_rmse_dx": 0.22750785946846008,
      "pose_rmse_dy": 0.1763806790113449,
      "pose_rmse_mean": 0.2941098213195801,
      "rmse_dtheta": 0.049317311495542526,
      "rmse_dx": 0.026432696729898453,
      "rmse_dy": 0.008969061076641083,
      "rmse_mean": 0.028239689767360687,
      "rotation_flip": 0.015169194899499416,
      "sparse_tokens": 16053.0,
      "step": 6207,
      "turn_loss": 0.24352045357227325,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.28842222635197917,
      "grad_norm": 0.5152486562728882,
      "learning_rate": 4.805682736216801e-06,
      "loss": 0.1281,
      "mae_dtheta": 0.009932962246239185,
      "mae_dx": 0.001908198813907802,
      "mae_dy": 0.0013570019509643316,
      "pose_mae_dtheta": 0.07501241564750671,
      "pose_mae_dx": 0.01981913484632969,
      "pose_mae_dy": 0.021522242575883865,
      "pose_rmse_dtheta": 0.24983273446559906,
      "pose_rmse_dx": 0.056064050644636154,
      "pose_rmse_dy": 0.06630177050828934,
      "pose_rmse_mean": 0.12406618893146515,
      "rmse_dtheta": 0.026528771966695786,
      "rmse_dx": 0.0055134776048362255,
      "rmse_dy": 0.0037468948867172003,
      "rmse_mean": 0.011929715052247047,
      "rotation_flip": 0.0017346054082736373,
      "sparse_tokens": 32153.0,
      "step": 6208,
      "turn_loss": 0.06783833354711533,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.28846868611782195,
      "grad_norm": 0.5526224970817566,
      "learning_rate": 4.804361522792278e-06,
      "loss": 0.1522,
      "mae_dtheta": 0.008582019247114658,
      "mae_dx": 0.0012216271134093404,
      "mae_dy": 0.001270031207241118,
      "pose_mae_dtheta": 0.05709683895111084,
      "pose_mae_dx": 0.013257704675197601,
      "pose_mae_dy": 0.01618979498744011,
      "pose_rmse_dtheta": 0.169258251786232,
      "pose_rmse_dx": 0.035489387810230255,
      "pose_rmse_dy": 0.038081713020801544,
      "pose_rmse_mean": 0.08094312250614166,
      "rmse_dtheta": 0.023334642872214317,
      "rmse_dx": 0.003675671759992838,
      "rmse_dy": 0.003187950002029538,
      "rmse_mean": 0.010066088289022446,
      "rotation_flip": 0.0037205456756055355,
      "sparse_tokens": 32153.0,
      "step": 6209,
      "turn_loss": 0.055274996906518936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18775.0,
      "epoch": 0.2885151458836647,
      "grad_norm": 0.34689903259277344,
      "learning_rate": 4.803040323048862e-06,
      "loss": 0.0825,
      "mae_dtheta": 0.03760848939418793,
      "mae_dx": 0.012826774269342422,
      "mae_dy": 0.006216856185346842,
      "pose_mae_dtheta": 0.26106226444244385,
      "pose_mae_dx": 0.09835034608840942,
      "pose_mae_dy": 0.06594802439212799,
      "pose_rmse_dtheta": 0.4461987614631653,
      "pose_rmse_dx": 0.21183401346206665,
      "pose_rmse_dy": 0.13686800003051758,
      "pose_rmse_mean": 0.2649669349193573,
      "rmse_dtheta": 0.05471506714820862,
      "rmse_dx": 0.02504829131066799,
      "rmse_dy": 0.011744839139282703,
      "rmse_mean": 0.03050273470580578,
      "rotation_flip": 0.020607374608516693,
      "sparse_tokens": 14471.0,
      "step": 6210,
      "turn_loss": 0.3502098619937897,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2885616056495075,
      "grad_norm": 0.4961317181587219,
      "learning_rate": 4.801719137078939e-06,
      "loss": 0.0805,
      "mae_dtheta": 0.009458143264055252,
      "mae_dx": 0.0012804488651454449,
      "mae_dy": 0.0016399568412452936,
      "pose_mae_dtheta": 0.0643477812409401,
      "pose_mae_dx": 0.017166489735245705,
      "pose_mae_dy": 0.021405618637800217,
      "pose_rmse_dtheta": 0.19133031368255615,
      "pose_rmse_dx": 0.04515812173485756,
      "pose_rmse_dy": 0.05471063405275345,
      "pose_rmse_mean": 0.09706635773181915,
      "rmse_dtheta": 0.023695368319749832,
      "rmse_dx": 0.003960752859711647,
      "rmse_dy": 0.0037600717041641474,
      "rmse_mean": 0.010472064837813377,
      "rotation_flip": 0.005578800570219755,
      "sparse_tokens": 32105.0,
      "step": 6211,
      "turn_loss": 0.08018306642770767,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.2886080654153503,
      "grad_norm": 0.49203598499298096,
      "learning_rate": 4.800397964974906e-06,
      "loss": 0.1338,
      "mae_dtheta": 0.040124084800481796,
      "mae_dx": 0.013258546590805054,
      "mae_dy": 0.008700075559318066,
      "pose_mae_dtheta": 0.31161394715309143,
      "pose_mae_dx": 0.10178390890359879,
      "pose_mae_dy": 0.10239087790250778,
      "pose_rmse_dtheta": 0.5243838429450989,
      "pose_rmse_dx": 0.20260107517242432,
      "pose_rmse_dy": 0.24983549118041992,
      "pose_rmse_mean": 0.3256068229675293,
      "rmse_dtheta": 0.059005554765462875,
      "rmse_dx": 0.02519337460398674,
      "rmse_dy": 0.018712805584073067,
      "rmse_mean": 0.03430391103029251,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 13811.0,
      "step": 6212,
      "turn_loss": 0.40125805139541626,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2886545251811931,
      "grad_norm": 0.42608535289764404,
      "learning_rate": 4.799076806829147e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.008726007305085659,
      "mae_dx": 0.0014768089167773724,
      "mae_dy": 0.0020067007280886173,
      "pose_mae_dtheta": 0.05452251806855202,
      "pose_mae_dx": 0.021930059418082237,
      "pose_mae_dy": 0.02370331808924675,
      "pose_rmse_dtheta": 0.12829875946044922,
      "pose_rmse_dx": 0.05442402511835098,
      "pose_rmse_dy": 0.049800753593444824,
      "pose_rmse_mean": 0.07750784605741501,
      "rmse_dtheta": 0.018860695883631706,
      "rmse_dx": 0.004559486638754606,
      "rmse_dy": 0.004106270149350166,
      "rmse_mean": 0.009175485000014305,
      "rotation_flip": 0.0032480715308338404,
      "sparse_tokens": 32073.0,
      "step": 6213,
      "turn_loss": 0.07157610356807709,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.2887009849470359,
      "grad_norm": 0.4842315912246704,
      "learning_rate": 4.797755662734056e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.006475495640188456,
      "mae_dx": 0.0024230859708040953,
      "mae_dy": 0.0008181537850759923,
      "pose_mae_dtheta": 0.04525129869580269,
      "pose_mae_dx": 0.020705638453364372,
      "pose_mae_dy": 0.011405492201447487,
      "pose_rmse_dtheta": 0.1909409612417221,
      "pose_rmse_dx": 0.04662010818719864,
      "pose_rmse_dy": 0.03208465874195099,
      "pose_rmse_mean": 0.08988191932439804,
      "rmse_dtheta": 0.022246701642870903,
      "rmse_dx": 0.006717225071042776,
      "rmse_dy": 0.0022153863683342934,
      "rmse_mean": 0.010393104515969753,
      "rotation_flip": 0.002957121701911092,
      "sparse_tokens": 32201.0,
      "step": 6214,
      "turn_loss": 0.08468443155288696,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.28874744471287866,
      "grad_norm": 0.42796462774276733,
      "learning_rate": 4.796434532782021e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.005314855370670557,
      "mae_dx": 0.0011282567866146564,
      "mae_dy": 0.0012235577451065183,
      "pose_mae_dtheta": 0.03840591013431549,
      "pose_mae_dx": 0.012990912422537804,
      "pose_mae_dy": 0.016530239954590797,
      "pose_rmse_dtheta": 0.0882158949971199,
      "pose_rmse_dx": 0.03559047356247902,
      "pose_rmse_dy": 0.047409508377313614,
      "pose_rmse_mean": 0.05707196146249771,
      "rmse_dtheta": 0.013304853811860085,
      "rmse_dx": 0.003620150266215205,
      "rmse_dy": 0.003290311899036169,
      "rmse_mean": 0.0067384387366473675,
      "rotation_flip": 0.0037735849618911743,
      "sparse_tokens": 32089.0,
      "step": 6215,
      "turn_loss": 0.0438140444457531,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.28879390447872144,
      "grad_norm": 0.4211014211177826,
      "learning_rate": 4.795113417065427e-06,
      "loss": 0.072,
      "mae_dtheta": 0.0066214026883244514,
      "mae_dx": 0.0014630330260843039,
      "mae_dy": 0.001379670575261116,
      "pose_mae_dtheta": 0.0428493395447731,
      "pose_mae_dx": 0.015976019203662872,
      "pose_mae_dy": 0.016491403803229332,
      "pose_rmse_dtheta": 0.09594426304101944,
      "pose_rmse_dx": 0.043336112052202225,
      "pose_rmse_dy": 0.03969871252775192,
      "pose_rmse_mean": 0.059659700840711594,
      "rmse_dtheta": 0.01507803238928318,
      "rmse_dx": 0.004595736041665077,
      "rmse_dy": 0.003514885203912854,
      "rmse_mean": 0.007729551754891872,
      "rotation_flip": 0.0008285004296340048,
      "sparse_tokens": 32153.0,
      "step": 6216,
      "turn_loss": 0.06029689311981201,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20127.0,
      "epoch": 0.2888403642445642,
      "grad_norm": 0.5484461784362793,
      "learning_rate": 4.793792315676665e-06,
      "loss": 0.1389,
      "mae_dtheta": 0.023653514683246613,
      "mae_dx": 0.008601591922342777,
      "mae_dy": 0.002234409796074033,
      "pose_mae_dtheta": 0.1830301731824875,
      "pose_mae_dx": 0.06393427401781082,
      "pose_mae_dy": 0.028067395091056824,
      "pose_rmse_dtheta": 0.3735547959804535,
      "pose_rmse_dx": 0.15268994867801666,
      "pose_rmse_dy": 0.08208849281072617,
      "pose_rmse_mean": 0.20277774333953857,
      "rmse_dtheta": 0.04370967671275139,
      "rmse_dx": 0.019427943974733353,
      "rmse_dy": 0.005227991845458746,
      "rmse_mean": 0.02278853766620159,
      "rotation_flip": 0.019662922248244286,
      "sparse_tokens": 15431.0,
      "step": 6217,
      "turn_loss": 0.15897299349308014,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.288886824010407,
      "grad_norm": 0.5548693537712097,
      "learning_rate": 4.792471228708113e-06,
      "loss": 0.1281,
      "mae_dtheta": 0.013319320045411587,
      "mae_dx": 0.0024085112381726503,
      "mae_dy": 0.0038073365576565266,
      "pose_mae_dtheta": 0.0911267027258873,
      "pose_mae_dx": 0.03697633370757103,
      "pose_mae_dy": 0.04199133813381195,
      "pose_rmse_dtheta": 0.2070164531469345,
      "pose_rmse_dx": 0.10595396161079407,
      "pose_rmse_dy": 0.11327721178531647,
      "pose_rmse_mean": 0.14208254218101501,
      "rmse_dtheta": 0.025568604469299316,
      "rmse_dx": 0.0066327485255897045,
      "rmse_dy": 0.009428405202925205,
      "rmse_mean": 0.013876586221158504,
      "rotation_flip": 0.0010348395444452763,
      "sparse_tokens": 32089.0,
      "step": 6218,
      "turn_loss": 0.10944917798042297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37198.0,
      "epoch": 0.28893328377624977,
      "grad_norm": 0.5772241950035095,
      "learning_rate": 4.7911501562521626e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.02986239269375801,
      "mae_dx": 0.012843084521591663,
      "mae_dy": 0.0034787701442837715,
      "pose_mae_dtheta": 0.24362605810165405,
      "pose_mae_dx": 0.10292771458625793,
      "pose_mae_dy": 0.053734276443719864,
      "pose_rmse_dtheta": 0.4481936991214752,
      "pose_rmse_dx": 0.2242392748594284,
      "pose_rmse_dy": 0.12763485312461853,
      "pose_rmse_mean": 0.266689270734787,
      "rmse_dtheta": 0.048027101904153824,
      "rmse_dx": 0.025217855349183083,
      "rmse_dy": 0.0066215842962265015,
      "rmse_mean": 0.02662218175828457,
      "rotation_flip": 0.00939849577844143,
      "sparse_tokens": 29531.0,
      "step": 6219,
      "turn_loss": 0.21212314069271088,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.28897974354209255,
      "grad_norm": 0.5279965400695801,
      "learning_rate": 4.789829098401191e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.021184241399168968,
      "mae_dx": 0.008890118449926376,
      "mae_dy": 0.004553354345262051,
      "pose_mae_dtheta": 0.13978365063667297,
      "pose_mae_dx": 0.06275872141122818,
      "pose_mae_dy": 0.046481985598802567,
      "pose_rmse_dtheta": 0.2457806020975113,
      "pose_rmse_dx": 0.1594596654176712,
      "pose_rmse_dy": 0.09088236838579178,
      "pose_rmse_mean": 0.16537421941757202,
      "rmse_dtheta": 0.033901147544384,
      "rmse_dx": 0.020548414438962936,
      "rmse_dy": 0.00849117711186409,
      "rmse_mean": 0.020980246365070343,
      "rotation_flip": 0.0066225165501236916,
      "sparse_tokens": 7833.0,
      "step": 6220,
      "turn_loss": 0.15607324242591858,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.2890262033079353,
      "grad_norm": 0.7659201622009277,
      "learning_rate": 4.788508055247585e-06,
      "loss": 0.2668,
      "mae_dtheta": 0.03752564266324043,
      "mae_dx": 0.01600039005279541,
      "mae_dy": 0.005309825763106346,
      "pose_mae_dtheta": 0.302779883146286,
      "pose_mae_dx": 0.13311736285686493,
      "pose_mae_dy": 0.07808907330036163,
      "pose_rmse_dtheta": 0.5290489792823792,
      "pose_rmse_dx": 0.2719520926475525,
      "pose_rmse_dy": 0.16486328840255737,
      "pose_rmse_mean": 0.32195478677749634,
      "rmse_dtheta": 0.05674336105585098,
      "rmse_dx": 0.03007643297314644,
      "rmse_dy": 0.010604992508888245,
      "rmse_mean": 0.032474931329488754,
      "rotation_flip": 0.0031397175043821335,
      "sparse_tokens": 10776.0,
      "step": 6221,
      "turn_loss": 0.341597318649292,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.2890726630737781,
      "grad_norm": 0.37153297662734985,
      "learning_rate": 4.787187026883724e-06,
      "loss": 0.0921,
      "mae_dtheta": 0.031721118837594986,
      "mae_dx": 0.00750473840162158,
      "mae_dy": 0.006235797423869371,
      "pose_mae_dtheta": 0.24299460649490356,
      "pose_mae_dx": 0.061841756105422974,
      "pose_mae_dy": 0.08075819909572601,
      "pose_rmse_dtheta": 0.5023288130760193,
      "pose_rmse_dx": 0.14798803627490997,
      "pose_rmse_dy": 0.1853947937488556,
      "pose_rmse_mean": 0.2785705327987671,
      "rmse_dtheta": 0.052678875625133514,
      "rmse_dx": 0.018436456099152565,
      "rmse_dy": 0.012406843714416027,
      "rmse_mean": 0.02784072421491146,
      "rotation_flip": 0.012738853693008423,
      "sparse_tokens": 10150.0,
      "step": 6222,
      "turn_loss": 0.19169265031814575,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.2891191228396209,
      "grad_norm": 0.4381124675273895,
      "learning_rate": 4.785866013401989e-06,
      "loss": 0.1037,
      "mae_dtheta": 0.028459986671805382,
      "mae_dx": 0.012808781117200851,
      "mae_dy": 0.0039986977353692055,
      "pose_mae_dtheta": 0.1955738067626953,
      "pose_mae_dx": 0.09515566378831863,
      "pose_mae_dy": 0.05064573884010315,
      "pose_rmse_dtheta": 0.32652533054351807,
      "pose_rmse_dx": 0.18484029173851013,
      "pose_rmse_dy": 0.12109606713056564,
      "pose_rmse_mean": 0.21082058548927307,
      "rmse_dtheta": 0.04139567166566849,
      "rmse_dx": 0.023989615961909294,
      "rmse_dy": 0.007359142415225506,
      "rmse_mean": 0.024248143658041954,
      "rotation_flip": 0.007614213041961193,
      "sparse_tokens": 6385.0,
      "step": 6223,
      "turn_loss": 0.22915126383304596,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.28916558260546366,
      "grad_norm": 0.41305211186408997,
      "learning_rate": 4.784545014894758e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.03430146351456642,
      "mae_dx": 0.00947609730064869,
      "mae_dy": 0.004172321874648333,
      "pose_mae_dtheta": 0.2826572358608246,
      "pose_mae_dx": 0.0871242880821228,
      "pose_mae_dy": 0.04347629100084305,
      "pose_rmse_dtheta": 0.541955828666687,
      "pose_rmse_dx": 0.22210663557052612,
      "pose_rmse_dy": 0.10890078544616699,
      "pose_rmse_mean": 0.2909877598285675,
      "rmse_dtheta": 0.05605064705014229,
      "rmse_dx": 0.02102997526526451,
      "rmse_dy": 0.008650003001093864,
      "rmse_mean": 0.02857687696814537,
      "rotation_flip": 0.006814309861510992,
      "sparse_tokens": 10784.0,
      "step": 6224,
      "turn_loss": 0.3283335864543915,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.28921204237130643,
      "grad_norm": 0.32535675168037415,
      "learning_rate": 4.783224031454409e-06,
      "loss": 0.0738,
      "mae_dtheta": 0.03286602720618248,
      "mae_dx": 0.007841053418815136,
      "mae_dy": 0.007907150313258171,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3253566026687622,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 122.38118743896484,
      "model/head/act_norm_mean": 102.24242350260417,
      "model/head/act_norm_min": 76.8965835571289,
      "model/head/act_over_embed": 70.26195063963948,
      "model/head/grad_frac": 0.13511234521865845,
      "model/head/grad_norm": 0.04395969212055206,
      "model/head/grad_zero_frac": 0.00013579231745097786,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6990234375,
      "model/head/update_ratio": 0.0007507493137381971,
      "model/head/weight_delta": 9.042328834533691,
      "model/head/weight_delta_rel": 0.15862922370433807,
      "model/head/weight_norm": 58.554420471191406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42093804478645325,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42090824246406555,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4208585321903229,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28925208482635706,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10765958577394485,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03502775728702545,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5501708984375,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001131958793848753,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9305808544158936,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09575121104717255,
      "model/modality_embedder.encoders.pose/weight_norm": 30.94437599182129,
      "model/modality_embedder/grad_frac": 0.10765958577394485,
      "model/modality_embedder/grad_norm": 0.03502775728702545,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5501708984375,
      "model/modality_embedder/update_ratio": 0.001131958793848753,
      "model/modality_embedder/weight_delta": 2.9305808544158936,
      "model/modality_embedder/weight_delta_rel": 0.09575121104717255,
      "model/modality_embedder/weight_norm": 30.94437599182129,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 64.63233184814453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.97906746031746,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.438551902770996,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.791430292149204,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09008236974477768,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.029308894649147987,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010516345500946045,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3219895362854004,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08461470156908035,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.869848251342773,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 66.22632598876953,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.83888888888889,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 13.200580596923828,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.382307627638532,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09482375532388687,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030851535499095917,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010415646247565746,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.942793607711792,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10194066911935806,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.62037467956543,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 68.20479583740234,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.517282572751323,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.596871376037598,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.535715480558032,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.100618876516819,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.032737016677856445,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001070483704097569,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.1734297275543213,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10655783116817474,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.581518173217773,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 69.319091796875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.52962962962963,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 14.289361000061035,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.918619217934776,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11318147927522659,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.036824341863393784,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012343163834884763,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7120656967163086,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09268553555011749,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.83379364013672,
      "model/normalizer/grad_frac": 0.41644567251205444,
      "model/normalizer/grad_norm": 0.13549335300922394,
      "model/normalizer/grad_zero_frac": 0.00017017032951116562,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017262747278437018,
      "model/normalizer/weight_delta": 5.741300106048584,
      "model/normalizer/weight_delta_rel": 0.07394462078809738,
      "model/normalizer/weight_norm": 78.4888687133789,
      "pose_mae_dtheta": 0.2206520140171051,
      "pose_mae_dx": 0.06922647356987,
      "pose_mae_dy": 0.09148562699556351,
      "pose_rmse_dtheta": 0.3948485553264618,
      "pose_rmse_dx": 0.13218747079372406,
      "pose_rmse_dy": 0.15879443287849426,
      "pose_rmse_mean": 0.22861015796661377,
      "rmse_dtheta": 0.04869692027568817,
      "rmse_dx": 0.0176098570227623,
      "rmse_dy": 0.011791550554335117,
      "rmse_mean": 0.02603277564048767,
      "rotation_flip": 0.01498127356171608,
      "sparse_tokens": 4365.0,
      "step": 6225,
      "turn_loss": 0.2432689517736435,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.2892585021371492,
      "grad_norm": 0.5994052290916443,
      "learning_rate": 4.781903063173321e-06,
      "loss": 0.1576,
      "mae_dtheta": 0.039790570735931396,
      "mae_dx": 0.009309888817369938,
      "mae_dy": 0.0028186305426061153,
      "pose_mae_dtheta": 0.31015050411224365,
      "pose_mae_dx": 0.07613563537597656,
      "pose_mae_dy": 0.02751595340669155,
      "pose_rmse_dtheta": 0.5580533742904663,
      "pose_rmse_dx": 0.169756218791008,
      "pose_rmse_dy": 0.0624767504632473,
      "pose_rmse_mean": 0.26342880725860596,
      "rmse_dtheta": 0.05996498838067055,
      "rmse_dx": 0.020174061879515648,
      "rmse_dy": 0.005781910382211208,
      "rmse_mean": 0.028640320524573326,
      "rotation_flip": 0.018333332613110542,
      "sparse_tokens": 10809.0,
      "step": 6226,
      "turn_loss": 0.2870519459247589,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.289304961902992,
      "grad_norm": 0.5502439141273499,
      "learning_rate": 4.780582110143868e-06,
      "loss": 0.1532,
      "mae_dtheta": 0.007361501920968294,
      "mae_dx": 0.0014095542719587684,
      "mae_dy": 0.001029804814606905,
      "pose_mae_dtheta": 0.05336298421025276,
      "pose_mae_dx": 0.013064339756965637,
      "pose_mae_dy": 0.01444915309548378,
      "pose_rmse_dtheta": 0.19081780314445496,
      "pose_rmse_dx": 0.03964197635650635,
      "pose_rmse_dy": 0.03820208087563515,
      "pose_rmse_mean": 0.08955395221710205,
      "rmse_dtheta": 0.023170601576566696,
      "rmse_dx": 0.004603108391165733,
      "rmse_dy": 0.004008895251899958,
      "rmse_mean": 0.01059420220553875,
      "rotation_flip": 0.0029036004561930895,
      "sparse_tokens": 32121.0,
      "step": 6227,
      "turn_loss": 0.04537586867809296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.28935142166883476,
      "grad_norm": 0.36400333046913147,
      "learning_rate": 4.7792611724584256e-06,
      "loss": 0.107,
      "mae_dtheta": 0.009816732257604599,
      "mae_dx": 0.001078722532838583,
      "mae_dy": 0.0019064157968387008,
      "pose_mae_dtheta": 0.0655074194073677,
      "pose_mae_dx": 0.01751996949315071,
      "pose_mae_dy": 0.02924841269850731,
      "pose_rmse_dtheta": 0.149067223072052,
      "pose_rmse_dx": 0.04542355611920357,
      "pose_rmse_dy": 0.06386105716228485,
      "pose_rmse_mean": 0.08611728250980377,
      "rmse_dtheta": 0.02037079446017742,
      "rmse_dx": 0.0031919730827212334,
      "rmse_dy": 0.003903157077729702,
      "rmse_mean": 0.009155308827757835,
      "rotation_flip": 0.0016006402438506484,
      "sparse_tokens": 32057.0,
      "step": 6228,
      "turn_loss": 0.06791198253631592,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.2893978814346776,
      "grad_norm": 0.4926097095012665,
      "learning_rate": 4.777940250209369e-06,
      "loss": 0.1335,
      "mae_dtheta": 0.04288642480969429,
      "mae_dx": 0.012559781782329082,
      "mae_dy": 0.005996255204081535,
      "pose_mae_dtheta": 0.31024324893951416,
      "pose_mae_dx": 0.09584341943264008,
      "pose_mae_dy": 0.08426368236541748,
      "pose_rmse_dtheta": 0.5778246521949768,
      "pose_rmse_dx": 0.21091720461845398,
      "pose_rmse_dy": 0.20052814483642578,
      "pose_rmse_mean": 0.3297566771507263,
      "rmse_dtheta": 0.0614498145878315,
      "rmse_dx": 0.025588029995560646,
      "rmse_dy": 0.010974312201142311,
      "rmse_mean": 0.03267072141170502,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 4161.0,
      "step": 6229,
      "turn_loss": 0.2419755607843399,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 27254.0,
      "epoch": 0.28944434120052037,
      "grad_norm": 0.6006618738174438,
      "learning_rate": 4.776619343489069e-06,
      "loss": 0.1923,
      "mae_dtheta": 0.03199383243918419,
      "mae_dx": 0.012324919924139977,
      "mae_dy": 0.004464109428226948,
      "pose_mae_dtheta": 0.21675613522529602,
      "pose_mae_dx": 0.09254785627126694,
      "pose_mae_dy": 0.054700158536434174,
      "pose_rmse_dtheta": 0.3771923780441284,
      "pose_rmse_dx": 0.20474129915237427,
      "pose_rmse_dy": 0.1325017809867859,
      "pose_rmse_mean": 0.2381451576948166,
      "rmse_dtheta": 0.04868191108107567,
      "rmse_dx": 0.024321412667632103,
      "rmse_dy": 0.009407096542418003,
      "rmse_mean": 0.027470139786601067,
      "rotation_flip": 0.013821138069033623,
      "sparse_tokens": 21255.0,
      "step": 6230,
      "turn_loss": 0.2623489499092102,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.28949080096636315,
      "grad_norm": 0.5711113214492798,
      "learning_rate": 4.7752984523899e-06,
      "loss": 0.1394,
      "mae_dtheta": 0.03583719581365585,
      "mae_dx": 0.006731724366545677,
      "mae_dy": 0.0032162759453058243,
      "pose_mae_dtheta": 0.2449643313884735,
      "pose_mae_dx": 0.03624812886118889,
      "pose_mae_dy": 0.04775578901171684,
      "pose_rmse_dtheta": 0.5088909268379211,
      "pose_rmse_dx": 0.090805284678936,
      "pose_rmse_dy": 0.13803201913833618,
      "pose_rmse_mean": 0.2459094226360321,
      "rmse_dtheta": 0.05944134294986725,
      "rmse_dx": 0.017071738839149475,
      "rmse_dy": 0.007157887797802687,
      "rmse_mean": 0.027890322729945183,
      "rotation_flip": 0.016997167840600014,
      "sparse_tokens": 5963.0,
      "step": 6231,
      "turn_loss": 0.2136504203081131,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2895372607322059,
      "grad_norm": 0.47966089844703674,
      "learning_rate": 4.773977577004228e-06,
      "loss": 0.1232,
      "mae_dtheta": 0.010592639446258545,
      "mae_dx": 0.0014744597719982266,
      "mae_dy": 0.0022893715649843216,
      "pose_mae_dtheta": 0.06753310561180115,
      "pose_mae_dx": 0.020463135093450546,
      "pose_mae_dy": 0.02847437560558319,
      "pose_rmse_dtheta": 0.15335626900196075,
      "pose_rmse_dx": 0.04611664637923241,
      "pose_rmse_dy": 0.062431130558252335,
      "pose_rmse_mean": 0.0873013585805893,
      "rmse_dtheta": 0.022206809371709824,
      "rmse_dx": 0.0044477167539298534,
      "rmse_dy": 0.00470493221655488,
      "rmse_mean": 0.010453153401613235,
      "rotation_flip": 0.0029739777091890574,
      "sparse_tokens": 32073.0,
      "step": 6232,
      "turn_loss": 0.08750158548355103,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2895837204980487,
      "grad_norm": 0.3572978675365448,
      "learning_rate": 4.772656717424428e-06,
      "loss": 0.0888,
      "mae_dtheta": 0.010258294641971588,
      "mae_dx": 0.0016110322903841734,
      "mae_dy": 0.0019865818321704865,
      "pose_mae_dtheta": 0.07202450931072235,
      "pose_mae_dx": 0.01811692863702774,
      "pose_mae_dy": 0.02345144748687744,
      "pose_rmse_dtheta": 0.20241330564022064,
      "pose_rmse_dx": 0.0488489530980587,
      "pose_rmse_dy": 0.05509930104017258,
      "pose_rmse_mean": 0.10212051868438721,
      "rmse_dtheta": 0.02460143156349659,
      "rmse_dx": 0.005141949746757746,
      "rmse_dy": 0.005345907993614674,
      "rmse_mean": 0.011696429923176765,
      "rotation_flip": 0.007136060856282711,
      "sparse_tokens": 32089.0,
      "step": 6233,
      "turn_loss": 0.0850994810461998,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.2896301802638915,
      "grad_norm": 0.6468617916107178,
      "learning_rate": 4.7713358737428635e-06,
      "loss": 0.1905,
      "mae_dtheta": 0.02792668156325817,
      "mae_dx": 0.008562738075852394,
      "mae_dy": 0.0035326576326042414,
      "pose_mae_dtheta": 0.2166600525379181,
      "pose_mae_dx": 0.07057759165763855,
      "pose_mae_dy": 0.03979969024658203,
      "pose_rmse_dtheta": 0.3645007610321045,
      "pose_rmse_dx": 0.15912578999996185,
      "pose_rmse_dy": 0.09205229580402374,
      "pose_rmse_mean": 0.20522628724575043,
      "rmse_dtheta": 0.04255557432770729,
      "rmse_dx": 0.018526608124375343,
      "rmse_dy": 0.00783606804907322,
      "rmse_mean": 0.022972751408815384,
      "rotation_flip": 0.006443298887461424,
      "sparse_tokens": 13298.0,
      "step": 6234,
      "turn_loss": 0.2574494779109955,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.28967664002973426,
      "grad_norm": 0.6173502802848816,
      "learning_rate": 4.770015046051904e-06,
      "loss": 0.205,
      "mae_dtheta": 0.008549812249839306,
      "mae_dx": 0.0010419116588309407,
      "mae_dy": 0.0018170049879699945,
      "pose_mae_dtheta": 0.054055988788604736,
      "pose_mae_dx": 0.01466926746070385,
      "pose_mae_dy": 0.023751303553581238,
      "pose_rmse_dtheta": 0.13010764122009277,
      "pose_rmse_dx": 0.035195667296648026,
      "pose_rmse_dy": 0.05534965544939041,
      "pose_rmse_mean": 0.0735509917140007,
      "rmse_dtheta": 0.020026685670018196,
      "rmse_dx": 0.0034333940129727125,
      "rmse_dy": 0.0038426262326538563,
      "rmse_mean": 0.009100901894271374,
      "rotation_flip": 0.006987258326262236,
      "sparse_tokens": 32057.0,
      "step": 6235,
      "turn_loss": 0.06703982502222061,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.28972309979557703,
      "grad_norm": 0.32231688499450684,
      "learning_rate": 4.768694234443919e-06,
      "loss": 0.0652,
      "mae_dtheta": 0.007378013338893652,
      "mae_dx": 0.001186093781143427,
      "mae_dy": 0.0015113749541342258,
      "pose_mae_dtheta": 0.05000526085495949,
      "pose_mae_dx": 0.014056042768061161,
      "pose_mae_dy": 0.020256439223885536,
      "pose_rmse_dtheta": 0.13013306260108948,
      "pose_rmse_dx": 0.0427783727645874,
      "pose_rmse_dy": 0.0476987287402153,
      "pose_rmse_mean": 0.07353672385215759,
      "rmse_dtheta": 0.018766039982438087,
      "rmse_dx": 0.004157304298132658,
      "rmse_dy": 0.0034083682112395763,
      "rmse_mean": 0.008777238428592682,
      "rotation_flip": 0.0044469148851931095,
      "sparse_tokens": 32041.0,
      "step": 6236,
      "turn_loss": 0.04838003218173981,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2897695595614198,
      "grad_norm": 0.6365064978599548,
      "learning_rate": 4.767373439011267e-06,
      "loss": 0.1717,
      "mae_dtheta": 0.009948592633008957,
      "mae_dx": 0.0015797984087839723,
      "mae_dy": 0.002246326534077525,
      "pose_mae_dtheta": 0.057670485228300095,
      "pose_mae_dx": 0.019166408106684685,
      "pose_mae_dy": 0.02112024836242199,
      "pose_rmse_dtheta": 0.1617477387189865,
      "pose_rmse_dx": 0.051273323595523834,
      "pose_rmse_dy": 0.051864489912986755,
      "pose_rmse_mean": 0.08829518407583237,
      "rmse_dtheta": 0.024194981902837753,
      "rmse_dx": 0.004068286158144474,
      "rmse_dy": 0.005405689124017954,
      "rmse_mean": 0.01122298650443554,
      "rotation_flip": 0.003702180227264762,
      "sparse_tokens": 32105.0,
      "step": 6237,
      "turn_loss": 0.08142602443695068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2898160193272626,
      "grad_norm": 0.47703880071640015,
      "learning_rate": 4.7660526598463175e-06,
      "loss": 0.0858,
      "mae_dtheta": 0.0072131347842514515,
      "mae_dx": 0.0015306328423321247,
      "mae_dy": 0.001544512459076941,
      "pose_mae_dtheta": 0.046246033161878586,
      "pose_mae_dx": 0.01670372672379017,
      "pose_mae_dy": 0.014258449897170067,
      "pose_rmse_dtheta": 0.11963015049695969,
      "pose_rmse_dx": 0.04043721780180931,
      "pose_rmse_dy": 0.03693427890539169,
      "pose_rmse_mean": 0.06566721200942993,
      "rmse_dtheta": 0.018105462193489075,
      "rmse_dx": 0.0037982475478202105,
      "rmse_dy": 0.0042063831351697445,
      "rmse_mean": 0.008703364990651608,
      "rotation_flip": 0.004359197802841663,
      "sparse_tokens": 32185.0,
      "step": 6238,
      "turn_loss": 0.059253983199596405,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.28986247909310536,
      "grad_norm": 0.56855309009552,
      "learning_rate": 4.7647318970414295e-06,
      "loss": 0.1048,
      "mae_dtheta": 0.04397296905517578,
      "mae_dx": 0.010815422050654888,
      "mae_dy": 0.005251807626336813,
      "pose_mae_dtheta": 0.3605493903160095,
      "pose_mae_dx": 0.08664438128471375,
      "pose_mae_dy": 0.07353182882070541,
      "pose_rmse_dtheta": 0.5839990973472595,
      "pose_rmse_dx": 0.19645465910434723,
      "pose_rmse_dy": 0.16761162877082825,
      "pose_rmse_mean": 0.31602180004119873,
      "rmse_dtheta": 0.06459910422563553,
      "rmse_dx": 0.022420652210712433,
      "rmse_dy": 0.011997933499515057,
      "rmse_mean": 0.03300589695572853,
      "rotation_flip": 0.009433962404727936,
      "sparse_tokens": 3555.0,
      "step": 6239,
      "turn_loss": 0.26958128809928894,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.28990893885894814,
      "grad_norm": 0.45353373885154724,
      "learning_rate": 4.7634111506889664e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.038758862763643265,
      "mae_dx": 0.010888299904763699,
      "mae_dy": 0.004670931026339531,
      "pose_mae_dtheta": 0.2820342779159546,
      "pose_mae_dx": 0.07502377033233643,
      "pose_mae_dy": 0.06786776334047318,
      "pose_rmse_dtheta": 0.49597084522247314,
      "pose_rmse_dx": 0.18493759632110596,
      "pose_rmse_dy": 0.14509187638759613,
      "pose_rmse_mean": 0.2753334641456604,
      "rmse_dtheta": 0.054759375751018524,
      "rmse_dx": 0.02382693998515606,
      "rmse_dy": 0.008024100214242935,
      "rmse_mean": 0.02887014113366604,
      "rotation_flip": 0.01413881778717041,
      "sparse_tokens": 13846.0,
      "step": 6240,
      "turn_loss": 0.27261343598365784,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 6845.0,
      "epoch": 0.2899553986247909,
      "grad_norm": 0.4648872911930084,
      "learning_rate": 4.762090420881289e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.040063802152872086,
      "mae_dx": 0.008743109181523323,
      "mae_dy": 0.006453895475715399,
      "pose_mae_dtheta": 0.3302431106567383,
      "pose_mae_dx": 0.06467920541763306,
      "pose_mae_dy": 0.060971565544605255,
      "pose_rmse_dtheta": 0.5647996068000793,
      "pose_rmse_dx": 0.14250566065311432,
      "pose_rmse_dy": 0.21635273098945618,
      "pose_rmse_mean": 0.307886004447937,
      "rmse_dtheta": 0.06021182984113693,
      "rmse_dx": 0.01740369014441967,
      "rmse_dy": 0.01841406710445881,
      "rmse_mean": 0.03200986236333847,
      "rotation_flip": 0.024128686636686325,
      "sparse_tokens": 5551.0,
      "step": 6241,
      "turn_loss": 0.34179720282554626,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2900018583906337,
      "grad_norm": 0.7554890513420105,
      "learning_rate": 4.760769707710756e-06,
      "loss": 0.1872,
      "mae_dtheta": 0.01379918958991766,
      "mae_dx": 0.0030467547476291656,
      "mae_dy": 0.003498803824186325,
      "pose_mae_dtheta": 0.101937435567379,
      "pose_mae_dx": 0.030809681862592697,
      "pose_mae_dy": 0.02957071363925934,
      "pose_rmse_dtheta": 0.2646839916706085,
      "pose_rmse_dx": 0.07304247468709946,
      "pose_rmse_dy": 0.06353481113910675,
      "pose_rmse_mean": 0.13375376164913177,
      "rmse_dtheta": 0.030173655599355698,
      "rmse_dx": 0.008346839807927608,
      "rmse_dy": 0.008378001861274242,
      "rmse_mean": 0.015632834285497665,
      "rotation_flip": 0.006358768325299025,
      "sparse_tokens": 32137.0,
      "step": 6242,
      "turn_loss": 0.1319105625152588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.29004831815647647,
      "grad_norm": 0.9112321138381958,
      "learning_rate": 4.759449011269726e-06,
      "loss": 0.2551,
      "mae_dtheta": 0.04383649677038193,
      "mae_dx": 0.011840409599244595,
      "mae_dy": 0.0034077949821949005,
      "pose_mae_dtheta": 0.3882604241371155,
      "pose_mae_dx": 0.08852565288543701,
      "pose_mae_dy": 0.054969485849142075,
      "pose_rmse_dtheta": 0.6778208017349243,
      "pose_rmse_dx": 0.1809930056333542,
      "pose_rmse_dy": 0.13525687158107758,
      "pose_rmse_mean": 0.3313569128513336,
      "rmse_dtheta": 0.06773192435503006,
      "rmse_dx": 0.023511547595262527,
      "rmse_dy": 0.006311006844043732,
      "rmse_mean": 0.032518163323402405,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 3102.0,
      "step": 6243,
      "turn_loss": 0.2989204227924347,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.29009477792231925,
      "grad_norm": 0.582915186882019,
      "learning_rate": 4.758128331650556e-06,
      "loss": 0.1352,
      "mae_dtheta": 0.04136474058032036,
      "mae_dx": 0.012164398096501827,
      "mae_dy": 0.0039427801966667175,
      "pose_mae_dtheta": 0.3172890841960907,
      "pose_mae_dx": 0.08872491121292114,
      "pose_mae_dy": 0.045920420438051224,
      "pose_rmse_dtheta": 0.5658616423606873,
      "pose_rmse_dx": 0.20587056875228882,
      "pose_rmse_dy": 0.1266045868396759,
      "pose_rmse_mean": 0.29944559931755066,
      "rmse_dtheta": 0.06104074418544769,
      "rmse_dx": 0.0249582938849926,
      "rmse_dy": 0.008567706681787968,
      "rmse_mean": 0.031522251665592194,
      "rotation_flip": 0.007151370868086815,
      "sparse_tokens": 12674.0,
      "step": 6244,
      "turn_loss": 0.27392154932022095,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2901412376881621,
      "grad_norm": 0.3915381133556366,
      "learning_rate": 4.756807668945601e-06,
      "loss": 0.0682,
      "mae_dtheta": 0.006905834190547466,
      "mae_dx": 0.0014653649413958192,
      "mae_dy": 0.001126267365179956,
      "pose_mae_dtheta": 0.05077601596713066,
      "pose_mae_dx": 0.014482554979622364,
      "pose_mae_dy": 0.014629448764026165,
      "pose_rmse_dtheta": 0.18051913380622864,
      "pose_rmse_dx": 0.04044850915670395,
      "pose_rmse_dy": 0.04550920054316521,
      "pose_rmse_mean": 0.08882561326026917,
      "rmse_dtheta": 0.02176843211054802,
      "rmse_dx": 0.004737772047519684,
      "rmse_dy": 0.003983397968113422,
      "rmse_mean": 0.0101632010191679,
      "rotation_flip": 0.001457017962820828,
      "sparse_tokens": 32169.0,
      "step": 6245,
      "turn_loss": 0.055365197360515594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.29018769745400486,
      "grad_norm": 0.5696155428886414,
      "learning_rate": 4.755487023247216e-06,
      "loss": 0.0799,
      "mae_dtheta": 0.03423134237527847,
      "mae_dx": 0.013580002821981907,
      "mae_dy": 0.0036158740986138582,
      "pose_mae_dtheta": 0.29016464948654175,
      "pose_mae_dx": 0.11568529903888702,
      "pose_mae_dy": 0.039037641137838364,
      "pose_rmse_dtheta": 0.4824640452861786,
      "pose_rmse_dx": 0.24812516570091248,
      "pose_rmse_dy": 0.0787128359079361,
      "pose_rmse_mean": 0.2697673439979553,
      "rmse_dtheta": 0.051433030515909195,
      "rmse_dx": 0.025392822921276093,
      "rmse_dy": 0.006426376756280661,
      "rmse_mean": 0.02775074541568756,
      "rotation_flip": 0.018817204982042313,
      "sparse_tokens": 6163.0,
      "step": 6246,
      "turn_loss": 0.2579720616340637,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.29023415721984763,
      "grad_norm": 0.709086000919342,
      "learning_rate": 4.754166394647755e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.010214499197900295,
      "mae_dx": 0.003439308376982808,
      "mae_dy": 0.0027335057966411114,
      "pose_mae_dtheta": 0.0818207785487175,
      "pose_mae_dx": 0.025989770889282227,
      "pose_mae_dy": 0.02265000529587269,
      "pose_rmse_dtheta": 0.25873127579689026,
      "pose_rmse_dx": 0.08216587454080582,
      "pose_rmse_dy": 0.08116571605205536,
      "pose_rmse_mean": 0.14068762958049774,
      "rmse_dtheta": 0.029017770662903786,
      "rmse_dx": 0.012076903134584427,
      "rmse_dy": 0.010663257911801338,
      "rmse_mean": 0.017252644523978233,
      "rotation_flip": 0.003630496095865965,
      "sparse_tokens": 32217.0,
      "step": 6247,
      "turn_loss": 0.11342187970876694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29756.0,
      "epoch": 0.2902806169856904,
      "grad_norm": 0.46041402220726013,
      "learning_rate": 4.752845783239571e-06,
      "loss": 0.1254,
      "mae_dtheta": 0.03635009005665779,
      "mae_dx": 0.015400247648358345,
      "mae_dy": 0.008539561182260513,
      "pose_mae_dtheta": 0.31443068385124207,
      "pose_mae_dx": 0.12754882872104645,
      "pose_mae_dy": 0.11226748675107956,
      "pose_rmse_dtheta": 0.5174546837806702,
      "pose_rmse_dx": 0.2572583854198456,
      "pose_rmse_dy": 0.2329695075750351,
      "pose_rmse_mean": 0.3358941972255707,
      "rmse_dtheta": 0.053425826132297516,
      "rmse_dx": 0.028570692986249924,
      "rmse_dy": 0.015855835750699043,
      "rmse_mean": 0.03261744976043701,
      "rotation_flip": 0.017100371420383453,
      "sparse_tokens": 23995.0,
      "step": 6248,
      "turn_loss": 0.33629390597343445,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.2903270767515332,
      "grad_norm": 0.754043698310852,
      "learning_rate": 4.751525189115012e-06,
      "loss": 0.2368,
      "mae_dtheta": 0.03248843550682068,
      "mae_dx": 0.007400864269584417,
      "mae_dy": 0.004068021196871996,
      "pose_mae_dtheta": 0.294651061296463,
      "pose_mae_dx": 0.05773170292377472,
      "pose_mae_dy": 0.05849286541342735,
      "pose_rmse_dtheta": 0.5639476180076599,
      "pose_rmse_dx": 0.15812942385673523,
      "pose_rmse_dy": 0.1393895298242569,
      "pose_rmse_mean": 0.28715550899505615,
      "rmse_dtheta": 0.05293073505163193,
      "rmse_dx": 0.019173583015799522,
      "rmse_dy": 0.007228329312056303,
      "rmse_mean": 0.026444217190146446,
      "rotation_flip": 0.01916932873427868,
      "sparse_tokens": 5484.0,
      "step": 6249,
      "turn_loss": 0.1813523918390274,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.29037353651737596,
      "grad_norm": 0.5901769995689392,
      "learning_rate": 4.750204612366432e-06,
      "loss": 0.1377,
      "mae_dtheta": 0.029936855658888817,
      "mae_dx": 0.008588438853621483,
      "mae_dy": 0.003089379286393523,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5901771187782288,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 144.9308319091797,
      "model/head/act_norm_mean": 101.85254693800404,
      "model/head/act_norm_min": 72.23464965820312,
      "model/head/act_over_embed": 69.99402381436437,
      "model/head/grad_frac": 0.11588558554649353,
      "model/head/grad_norm": 0.06839302182197571,
      "model/head/grad_zero_frac": 0.00012151508417446166,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6833102318548387,
      "model/head/update_ratio": 0.0011679655872285366,
      "model/head/weight_delta": 9.055998802185059,
      "model/head/weight_delta_rel": 0.15886904299259186,
      "model/head/weight_norm": 58.557395935058594,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4209655225276947,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42091071605682373,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4208586513996124,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2892537847024586,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08449241518974304,
      "model/modality_embedder.encoders.pose/grad_norm": 0.049865491688251495,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.54638671875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016114567406475544,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9336633682250977,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09585192799568176,
      "model/modality_embedder.encoders.pose/weight_norm": 30.94435691833496,
      "model/modality_embedder/grad_frac": 0.08449241518974304,
      "model/modality_embedder/grad_norm": 0.049865491688251495,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.54638671875,
      "model/modality_embedder/update_ratio": 0.0016114567406475544,
      "model/modality_embedder/weight_delta": 2.9336633682250977,
      "model/modality_embedder/weight_delta_rel": 0.09585192799568176,
      "model/modality_embedder/weight_norm": 30.94435691833496,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.14413452148438,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.926207277265746,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.2138671875,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.755104279471237,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08883681148290634,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.052429452538490295,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018811568152159452,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3271825313568115,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08480393886566162,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.87085723876953,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.32957458496094,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.77183139720942,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.854242324829102,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.336225091554272,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08752616494894028,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05165594071149826,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017438362119719386,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.9492952823638916,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10216589272022247,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.622013092041016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.1402816772461,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.470814132104454,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.343700408935547,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.50378193310111,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08597206324338913,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05073874443769455,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001659009954892099,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.1810901165008545,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10681504756212234,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.583749771118164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 80.01882934570312,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.32979310675883,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.757399559020996,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.781289688518964,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09107406437397003,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05374982953071594,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001801524544134736,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7187798023223877,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09291499108076096,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.83574676513672,
      "model/normalizer/grad_frac": 0.3773234486579895,
      "model/normalizer/grad_norm": 0.22268766164779663,
      "model/normalizer/grad_zero_frac": 0.00017135207599494606,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0028371058870106936,
      "model/normalizer/weight_delta": 5.754736423492432,
      "model/normalizer/weight_delta_rel": 0.07411767542362213,
      "model/normalizer/weight_norm": 78.49113464355469,
      "pose_mae_dtheta": 0.22004492580890656,
      "pose_mae_dx": 0.05236275494098663,
      "pose_mae_dy": 0.039490945637226105,
      "pose_rmse_dtheta": 0.4002211093902588,
      "pose_rmse_dx": 0.1373423933982849,
      "pose_rmse_dy": 0.09316769242286682,
      "pose_rmse_mean": 0.21024374663829803,
      "rmse_dtheta": 0.048430994153022766,
      "rmse_dx": 0.019120270386338234,
      "rmse_dy": 0.006905301008373499,
      "rmse_mean": 0.02481885626912117,
      "rotation_flip": 0.015717092901468277,
      "sparse_tokens": 8349.0,
      "step": 6250,
      "turn_loss": 0.249453604221344,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.29041999628321874,
      "grad_norm": 0.6911571025848389,
      "learning_rate": 4.7488840530861755e-06,
      "loss": 0.123,
      "mae_dtheta": 0.05616970360279083,
      "mae_dx": 0.011237556114792824,
      "mae_dy": 0.002058012643828988,
      "pose_mae_dtheta": 0.5033767223358154,
      "pose_mae_dx": 0.09672563523054123,
      "pose_mae_dy": 0.02534896694123745,
      "pose_rmse_dtheta": 0.8064737319946289,
      "pose_rmse_dx": 0.20306172966957092,
      "pose_rmse_dy": 0.05153898894786835,
      "pose_rmse_mean": 0.3536914587020874,
      "rmse_dtheta": 0.07716880738735199,
      "rmse_dx": 0.021058058366179466,
      "rmse_dy": 0.004861101973801851,
      "rmse_mean": 0.034362658858299255,
      "rotation_flip": 0.0234375,
      "sparse_tokens": 6249.0,
      "step": 6251,
      "turn_loss": 0.3200820982456207,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2904664560490615,
      "grad_norm": 0.44525766372680664,
      "learning_rate": 4.747563511366594e-06,
      "loss": 0.1172,
      "mae_dtheta": 0.013986792415380478,
      "mae_dx": 0.0022751863580197096,
      "mae_dy": 0.0038310240488499403,
      "pose_mae_dtheta": 0.09285980463027954,
      "pose_mae_dx": 0.03486202657222748,
      "pose_mae_dy": 0.038559313863515854,
      "pose_rmse_dtheta": 0.2172071635723114,
      "pose_rmse_dx": 0.08747823536396027,
      "pose_rmse_dy": 0.08451221138238907,
      "pose_rmse_mean": 0.12973254919052124,
      "rmse_dtheta": 0.027915257960557938,
      "rmse_dx": 0.006578854285180569,
      "rmse_dy": 0.00821464043110609,
      "rmse_mean": 0.014236251823604107,
      "rotation_flip": 0.0036399734672158957,
      "sparse_tokens": 32073.0,
      "step": 6252,
      "turn_loss": 0.12231728434562683,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.2905129158149043,
      "grad_norm": 0.5188244581222534,
      "learning_rate": 4.74624298730003e-06,
      "loss": 0.1083,
      "mae_dtheta": 0.03224837779998779,
      "mae_dx": 0.009271032176911831,
      "mae_dy": 0.0030881643760949373,
      "pose_mae_dtheta": 0.2589873969554901,
      "pose_mae_dx": 0.07254995405673981,
      "pose_mae_dy": 0.04834940284490585,
      "pose_rmse_dtheta": 0.4250018000602722,
      "pose_rmse_dx": 0.15372395515441895,
      "pose_rmse_dy": 0.10833791643381119,
      "pose_rmse_mean": 0.22902123630046844,
      "rmse_dtheta": 0.049046117812395096,
      "rmse_dx": 0.019566074013710022,
      "rmse_dy": 0.005770355463027954,
      "rmse_mean": 0.024794181808829308,
      "rotation_flip": 0.010296010412275791,
      "sparse_tokens": 12557.0,
      "step": 6253,
      "turn_loss": 0.22325129806995392,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.29055937558074707,
      "grad_norm": 0.33959975838661194,
      "learning_rate": 4.74492248097883e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.007395395077764988,
      "mae_dx": 0.0014547163154929876,
      "mae_dy": 0.0018642782233655453,
      "pose_mae_dtheta": 0.052129216492176056,
      "pose_mae_dx": 0.012575210072100163,
      "pose_mae_dy": 0.018646595999598503,
      "pose_rmse_dtheta": 0.1649370938539505,
      "pose_rmse_dx": 0.04504937306046486,
      "pose_rmse_dy": 0.06571526825428009,
      "pose_rmse_mean": 0.09190057963132858,
      "rmse_dtheta": 0.020844751968979836,
      "rmse_dx": 0.005553143098950386,
      "rmse_dy": 0.007476107683032751,
      "rmse_mean": 0.01129133440554142,
      "rotation_flip": 0.008556759916245937,
      "sparse_tokens": 32073.0,
      "step": 6254,
      "turn_loss": 0.07359395176172256,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.29060583534658985,
      "grad_norm": 0.5476472973823547,
      "learning_rate": 4.743601992495339e-06,
      "loss": 0.1511,
      "mae_dtheta": 0.037890028208494186,
      "mae_dx": 0.010198167525231838,
      "mae_dy": 0.005107329227030277,
      "pose_mae_dtheta": 0.32989346981048584,
      "pose_mae_dx": 0.08196602761745453,
      "pose_mae_dy": 0.05734856054186821,
      "pose_rmse_dtheta": 0.5514789819717407,
      "pose_rmse_dx": 0.17348751425743103,
      "pose_rmse_dy": 0.1268039047718048,
      "pose_rmse_mean": 0.283923476934433,
      "rmse_dtheta": 0.05686681717634201,
      "rmse_dx": 0.021396461874246597,
      "rmse_dy": 0.01208470854908228,
      "rmse_mean": 0.030115997418761253,
      "rotation_flip": 0.01441899873316288,
      "sparse_tokens": 19226.0,
      "step": 6255,
      "turn_loss": 0.30191874504089355,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.2906522951124326,
      "grad_norm": 0.5187394618988037,
      "learning_rate": 4.742281521941897e-06,
      "loss": 0.1715,
      "mae_dtheta": 0.023761970922350883,
      "mae_dx": 0.009270120412111282,
      "mae_dy": 0.0026198714040219784,
      "pose_mae_dtheta": 0.16679783165454865,
      "pose_mae_dx": 0.07893291115760803,
      "pose_mae_dy": 0.03490452468395233,
      "pose_rmse_dtheta": 0.3168974220752716,
      "pose_rmse_dx": 0.1987019032239914,
      "pose_rmse_dy": 0.07593346387147903,
      "pose_rmse_mean": 0.19717758893966675,
      "rmse_dtheta": 0.040511853992938995,
      "rmse_dx": 0.02156197465956211,
      "rmse_dy": 0.005101673770695925,
      "rmse_mean": 0.02239183336496353,
      "rotation_flip": 0.005242464132606983,
      "sparse_tokens": 15651.0,
      "step": 6256,
      "turn_loss": 0.16964265704154968,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 14897.0,
      "epoch": 0.2906987548782754,
      "grad_norm": 1.1346068382263184,
      "learning_rate": 4.740961069410848e-06,
      "loss": 0.2539,
      "mae_dtheta": 0.02953176014125347,
      "mae_dx": 0.009207022376358509,
      "mae_dy": 0.0030618649907410145,
      "pose_mae_dtheta": 0.2549137771129608,
      "pose_mae_dx": 0.06431201845407486,
      "pose_mae_dy": 0.050093844532966614,
      "pose_rmse_dtheta": 0.5007951259613037,
      "pose_rmse_dx": 0.1554930955171585,
      "pose_rmse_dy": 0.12028798460960388,
      "pose_rmse_mean": 0.25885874032974243,
      "rmse_dtheta": 0.05187494307756424,
      "rmse_dx": 0.021021408960223198,
      "rmse_dy": 0.0060550374910235405,
      "rmse_mean": 0.026317130774259567,
      "rotation_flip": 0.00988467875868082,
      "sparse_tokens": 11425.0,
      "step": 6257,
      "turn_loss": 0.20434734225273132,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.2907452146441182,
      "grad_norm": 0.711936891078949,
      "learning_rate": 4.739640634994529e-06,
      "loss": 0.1548,
      "mae_dtheta": 0.028476515784859657,
      "mae_dx": 0.005204548593610525,
      "mae_dy": 0.00426786532625556,
      "pose_mae_dtheta": 0.20637698471546173,
      "pose_mae_dx": 0.05126405134797096,
      "pose_mae_dy": 0.0523025207221508,
      "pose_rmse_dtheta": 0.4276646375656128,
      "pose_rmse_dx": 0.1669401079416275,
      "pose_rmse_dy": 0.127961203455925,
      "pose_rmse_mean": 0.24085532128810883,
      "rmse_dtheta": 0.04855171591043472,
      "rmse_dx": 0.0160886961966753,
      "rmse_dy": 0.008298533037304878,
      "rmse_mean": 0.024312980473041534,
      "rotation_flip": 0.017391303554177284,
      "sparse_tokens": 10272.0,
      "step": 6258,
      "turn_loss": 0.20207473635673523,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.29079167440996095,
      "grad_norm": 0.5706160068511963,
      "learning_rate": 4.738320218785281e-06,
      "loss": 0.1359,
      "mae_dtheta": 0.012476950883865356,
      "mae_dx": 0.002130908891558647,
      "mae_dy": 0.003779654623940587,
      "pose_mae_dtheta": 0.07993322610855103,
      "pose_mae_dx": 0.025805560871958733,
      "pose_mae_dy": 0.033502060920000076,
      "pose_rmse_dtheta": 0.16590800881385803,
      "pose_rmse_dx": 0.0705505758523941,
      "pose_rmse_dy": 0.06673034280538559,
      "pose_rmse_mean": 0.10106297582387924,
      "rmse_dtheta": 0.023844480514526367,
      "rmse_dx": 0.005528619512915611,
      "rmse_dy": 0.007968475110828876,
      "rmse_mean": 0.012447192333638668,
      "rotation_flip": 0.010480053722858429,
      "sparse_tokens": 32089.0,
      "step": 6259,
      "turn_loss": 0.10637474060058594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.29083813417580373,
      "grad_norm": 0.5993891954421997,
      "learning_rate": 4.736999820875441e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.010463159531354904,
      "mae_dx": 0.002421061508357525,
      "mae_dy": 0.001820941804908216,
      "pose_mae_dtheta": 0.07049103081226349,
      "pose_mae_dx": 0.025305481627583504,
      "pose_mae_dy": 0.02471235767006874,
      "pose_rmse_dtheta": 0.18582919239997864,
      "pose_rmse_dx": 0.06382542103528976,
      "pose_rmse_dy": 0.060252878814935684,
      "pose_rmse_mean": 0.103302501142025,
      "rmse_dtheta": 0.022948462516069412,
      "rmse_dx": 0.00768327247351408,
      "rmse_dy": 0.003693994600325823,
      "rmse_mean": 0.01144191063940525,
      "rotation_flip": 0.007507507689297199,
      "sparse_tokens": 32073.0,
      "step": 6260,
      "turn_loss": 0.107188880443573,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2908845939416465,
      "grad_norm": 0.4673171937465668,
      "learning_rate": 4.735679441357343e-06,
      "loss": 0.1694,
      "mae_dtheta": 0.01565796323120594,
      "mae_dx": 0.0024315225891768932,
      "mae_dy": 0.002978390082716942,
      "pose_mae_dtheta": 0.10372976958751678,
      "pose_mae_dx": 0.02972080372273922,
      "pose_mae_dy": 0.032877933233976364,
      "pose_rmse_dtheta": 0.26294341683387756,
      "pose_rmse_dx": 0.08168654143810272,
      "pose_rmse_dy": 0.08184996247291565,
      "pose_rmse_mean": 0.14215996861457825,
      "rmse_dtheta": 0.033095456659793854,
      "rmse_dx": 0.006214951630681753,
      "rmse_dy": 0.006835315842181444,
      "rmse_mean": 0.015381908044219017,
      "rotation_flip": 0.005942947696894407,
      "sparse_tokens": 32089.0,
      "step": 6261,
      "turn_loss": 0.1303882598876953,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.29093105370748934,
      "grad_norm": 0.3528617322444916,
      "learning_rate": 4.734359080323326e-06,
      "loss": 0.0813,
      "mae_dtheta": 0.008293697610497475,
      "mae_dx": 0.001663298811763525,
      "mae_dy": 0.0018707325216382742,
      "pose_mae_dtheta": 0.06327074021100998,
      "pose_mae_dx": 0.021373746916651726,
      "pose_mae_dy": 0.02601308375597,
      "pose_rmse_dtheta": 0.1705661416053772,
      "pose_rmse_dx": 0.05897228419780731,
      "pose_rmse_dy": 0.06701479852199554,
      "pose_rmse_mean": 0.09885107725858688,
      "rmse_dtheta": 0.020043671131134033,
      "rmse_dx": 0.0050647323951125145,
      "rmse_dy": 0.004337452817708254,
      "rmse_mean": 0.009815285913646221,
      "rotation_flip": 0.003882418153807521,
      "sparse_tokens": 32073.0,
      "step": 6262,
      "turn_loss": 0.06620102375745773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2909775134733321,
      "grad_norm": 0.4910300374031067,
      "learning_rate": 4.73303873786572e-06,
      "loss": 0.1308,
      "mae_dtheta": 0.008576637133955956,
      "mae_dx": 0.0017356571042910218,
      "mae_dy": 0.0012992824194952846,
      "pose_mae_dtheta": 0.06084044650197029,
      "pose_mae_dx": 0.01801099069416523,
      "pose_mae_dy": 0.014343708753585815,
      "pose_rmse_dtheta": 0.22374719381332397,
      "pose_rmse_dx": 0.04573381319642067,
      "pose_rmse_dy": 0.03655388206243515,
      "pose_rmse_mean": 0.10201163589954376,
      "rmse_dtheta": 0.026506802067160606,
      "rmse_dx": 0.005360262002795935,
      "rmse_dy": 0.003773247357457876,
      "rmse_mean": 0.011880103498697281,
      "rotation_flip": 0.0047095762565732,
      "sparse_tokens": 32121.0,
      "step": 6263,
      "turn_loss": 0.0700964704155922,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.2910239732391749,
      "grad_norm": 0.8586657047271729,
      "learning_rate": 4.731718414076858e-06,
      "loss": 0.1559,
      "mae_dtheta": 0.02623346820473671,
      "mae_dx": 0.01193954050540924,
      "mae_dy": 0.007278470788151026,
      "pose_mae_dtheta": 0.20184023678302765,
      "pose_mae_dx": 0.0920218899846077,
      "pose_mae_dy": 0.07374291867017746,
      "pose_rmse_dtheta": 0.41732245683670044,
      "pose_rmse_dx": 0.21423514187335968,
      "pose_rmse_dy": 0.16539442539215088,
      "pose_rmse_mean": 0.2656506896018982,
      "rmse_dtheta": 0.04783063381910324,
      "rmse_dx": 0.023576611652970314,
      "rmse_dy": 0.014385932125151157,
      "rmse_mean": 0.028597725555300713,
      "rotation_flip": 0.0,
      "sparse_tokens": 3799.0,
      "step": 6264,
      "turn_loss": 0.3133508861064911,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.29107043300501767,
      "grad_norm": 0.5978288650512695,
      "learning_rate": 4.7303981090490715e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.0304032564163208,
      "mae_dx": 0.01023702509701252,
      "mae_dy": 0.00473784189671278,
      "pose_mae_dtheta": 0.22467489540576935,
      "pose_mae_dx": 0.09886863827705383,
      "pose_mae_dy": 0.04591008275747299,
      "pose_rmse_dtheta": 0.3771688640117645,
      "pose_rmse_dx": 0.23223240673542023,
      "pose_rmse_dy": 0.09732397645711899,
      "pose_rmse_mean": 0.23557507991790771,
      "rmse_dtheta": 0.04544515162706375,
      "rmse_dx": 0.02298511378467083,
      "rmse_dy": 0.008754025213420391,
      "rmse_mean": 0.025728097185492516,
      "rotation_flip": 0.017681729048490524,
      "sparse_tokens": 9079.0,
      "step": 6265,
      "turn_loss": 0.256439745426178,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 35688.0,
      "epoch": 0.29111689277086045,
      "grad_norm": 0.530389666557312,
      "learning_rate": 4.729077822874689e-06,
      "loss": 0.1502,
      "mae_dtheta": 0.03172384575009346,
      "mae_dx": 0.013704693876206875,
      "mae_dy": 0.0038758416194468737,
      "pose_mae_dtheta": 0.24584977328777313,
      "pose_mae_dx": 0.11542273312807083,
      "pose_mae_dy": 0.050486765801906586,
      "pose_rmse_dtheta": 0.4298228621482849,
      "pose_rmse_dx": 0.25867822766304016,
      "pose_rmse_dy": 0.1292692869901657,
      "pose_rmse_mean": 0.27259016036987305,
      "rmse_dtheta": 0.04795925319194794,
      "rmse_dx": 0.02715584821999073,
      "rmse_dy": 0.008579711429774761,
      "rmse_mean": 0.02789827063679695,
      "rotation_flip": 0.011473430320620537,
      "sparse_tokens": 27137.0,
      "step": 6266,
      "turn_loss": 0.2649948298931122,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2911633525367032,
      "grad_norm": 0.4426652491092682,
      "learning_rate": 4.7277575556460415e-06,
      "loss": 0.1596,
      "mae_dtheta": 0.010101952590048313,
      "mae_dx": 0.0018021248979493976,
      "mae_dy": 0.002073999959975481,
      "pose_mae_dtheta": 0.06837675720453262,
      "pose_mae_dx": 0.020150205120444298,
      "pose_mae_dy": 0.02224133536219597,
      "pose_rmse_dtheta": 0.2015605866909027,
      "pose_rmse_dx": 0.052339520305395126,
      "pose_rmse_dy": 0.05272576957941055,
      "pose_rmse_mean": 0.10220862925052643,
      "rmse_dtheta": 0.024499613791704178,
      "rmse_dx": 0.00552352424710989,
      "rmse_dy": 0.004436691291630268,
      "rmse_mean": 0.011486610397696495,
      "rotation_flip": 0.006796941161155701,
      "sparse_tokens": 32089.0,
      "step": 6267,
      "turn_loss": 0.08472178876399994,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.291209812302546,
      "grad_norm": 0.9470430612564087,
      "learning_rate": 4.726437307455452e-06,
      "loss": 0.2656,
      "mae_dtheta": 0.02801170013844967,
      "mae_dx": 0.008357862941920757,
      "mae_dy": 0.0038670236244797707,
      "pose_mae_dtheta": 0.20405420660972595,
      "pose_mae_dx": 0.07675378024578094,
      "pose_mae_dy": 0.06364274770021439,
      "pose_rmse_dtheta": 0.39704856276512146,
      "pose_rmse_dx": 0.20491628348827362,
      "pose_rmse_dy": 0.12279672920703888,
      "pose_rmse_mean": 0.24158719182014465,
      "rmse_dtheta": 0.044934868812561035,
      "rmse_dx": 0.021050741896033287,
      "rmse_dy": 0.0065507832914590836,
      "rmse_mean": 0.024178799241781235,
      "rotation_flip": 0.01295336801558733,
      "sparse_tokens": 14632.0,
      "step": 6268,
      "turn_loss": 0.24249257147312164,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2912562720683888,
      "grad_norm": 0.4420096278190613,
      "learning_rate": 4.725117078395251e-06,
      "loss": 0.0592,
      "mae_dtheta": 0.006725307088345289,
      "mae_dx": 0.0014891986502334476,
      "mae_dy": 0.0005801446386612952,
      "pose_mae_dtheta": 0.04747913405299187,
      "pose_mae_dx": 0.01286702137440443,
      "pose_mae_dy": 0.00785587728023529,
      "pose_rmse_dtheta": 0.18392331898212433,
      "pose_rmse_dx": 0.031611695885658264,
      "pose_rmse_dy": 0.02287525311112404,
      "pose_rmse_mean": 0.07947009056806564,
      "rmse_dtheta": 0.02263030782341957,
      "rmse_dx": 0.004363553132861853,
      "rmse_dy": 0.0014989335322752595,
      "rmse_mean": 0.009497598744928837,
      "rotation_flip": 0.005353318993002176,
      "sparse_tokens": 32185.0,
      "step": 6269,
      "turn_loss": 0.047373026609420776,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.29130273183423155,
      "grad_norm": 0.6027112603187561,
      "learning_rate": 4.723796868557758e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.006245651748031378,
      "mae_dx": 0.000990711385384202,
      "mae_dy": 0.0010556519264355302,
      "pose_mae_dtheta": 0.04248872399330139,
      "pose_mae_dx": 0.013155504129827023,
      "pose_mae_dy": 0.017817910760641098,
      "pose_rmse_dtheta": 0.12083998322486877,
      "pose_rmse_dx": 0.0366833321750164,
      "pose_rmse_dy": 0.05050622299313545,
      "pose_rmse_mean": 0.06934317946434021,
      "rmse_dtheta": 0.01721671223640442,
      "rmse_dx": 0.0036454375367611647,
      "rmse_dy": 0.002567514544352889,
      "rmse_mean": 0.007809888105839491,
      "rotation_flip": 0.006042296066880226,
      "sparse_tokens": 32057.0,
      "step": 6270,
      "turn_loss": 0.049477823078632355,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.29134919160007433,
      "grad_norm": 0.6729578375816345,
      "learning_rate": 4.7224766780353005e-06,
      "loss": 0.1736,
      "mae_dtheta": 0.011514122597873211,
      "mae_dx": 0.00158993573859334,
      "mae_dy": 0.0029714617412537336,
      "pose_mae_dtheta": 0.07691027969121933,
      "pose_mae_dx": 0.0220026895403862,
      "pose_mae_dy": 0.03501640632748604,
      "pose_rmse_dtheta": 0.1582871824502945,
      "pose_rmse_dx": 0.05757001414895058,
      "pose_rmse_dy": 0.08477182686328888,
      "pose_rmse_mean": 0.10020967572927475,
      "rmse_dtheta": 0.022247735410928726,
      "rmse_dx": 0.005158326588571072,
      "rmse_dy": 0.006604851223528385,
      "rmse_mean": 0.011336971074342728,
      "rotation_flip": 0.014141414314508438,
      "sparse_tokens": 32041.0,
      "step": 6271,
      "turn_loss": 0.08648749440908432,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2913956513659171,
      "grad_norm": 0.31528469920158386,
      "learning_rate": 4.721156506920196e-06,
      "loss": 0.0784,
      "mae_dtheta": 0.01177531760185957,
      "mae_dx": 0.002156163565814495,
      "mae_dy": 0.002318036276847124,
      "pose_mae_dtheta": 0.08151951432228088,
      "pose_mae_dx": 0.030189573764801025,
      "pose_mae_dy": 0.03374055400490761,
      "pose_rmse_dtheta": 0.1624317169189453,
      "pose_rmse_dx": 0.0716637521982193,
      "pose_rmse_dy": 0.08045686036348343,
      "pose_rmse_mean": 0.10485078394412994,
      "rmse_dtheta": 0.021302126348018646,
      "rmse_dx": 0.006854219362139702,
      "rmse_dy": 0.0046652527526021,
      "rmse_mean": 0.010940533131361008,
      "rotation_flip": 0.004514672793447971,
      "sparse_tokens": 32073.0,
      "step": 6272,
      "turn_loss": 0.08403491228818893,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.2914421111317599,
      "grad_norm": 0.4724230170249939,
      "learning_rate": 4.719836355304766e-06,
      "loss": 0.0944,
      "mae_dtheta": 0.023100968450307846,
      "mae_dx": 0.010346419177949429,
      "mae_dy": 0.002936591161414981,
      "pose_mae_dtheta": 0.18420125544071198,
      "pose_mae_dx": 0.07607344537973404,
      "pose_mae_dy": 0.058725763112306595,
      "pose_rmse_dtheta": 0.32889145612716675,
      "pose_rmse_dx": 0.16915248334407806,
      "pose_rmse_dy": 0.11712661385536194,
      "pose_rmse_mean": 0.20505687594413757,
      "rmse_dtheta": 0.040059030055999756,
      "rmse_dx": 0.0229454655200243,
      "rmse_dy": 0.004881543107330799,
      "rmse_mean": 0.022628679871559143,
      "rotation_flip": 0.003597122384235263,
      "sparse_tokens": 5056.0,
      "step": 6273,
      "turn_loss": 0.13022011518478394,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 36228.0,
      "epoch": 0.29148857089760266,
      "grad_norm": 0.3773306906223297,
      "learning_rate": 4.7185162232813326e-06,
      "loss": 0.1139,
      "mae_dtheta": 0.03506026417016983,
      "mae_dx": 0.010785588063299656,
      "mae_dy": 0.005621840711683035,
      "pose_mae_dtheta": 0.2804587483406067,
      "pose_mae_dx": 0.0920177698135376,
      "pose_mae_dy": 0.06259538978338242,
      "pose_rmse_dtheta": 0.5155272483825684,
      "pose_rmse_dx": 0.2019273191690445,
      "pose_rmse_dy": 0.13673555850982666,
      "pose_rmse_mean": 0.28473004698753357,
      "rmse_dtheta": 0.05536631494760513,
      "rmse_dx": 0.02319677546620369,
      "rmse_dy": 0.012488356791436672,
      "rmse_mean": 0.03035048395395279,
      "rotation_flip": 0.01034482754766941,
      "sparse_tokens": 27448.0,
      "step": 6274,
      "turn_loss": 0.2789062559604645,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.29153503066344544,
      "grad_norm": 0.42478513717651367,
      "learning_rate": 4.717196110942208e-06,
      "loss": 0.1301,
      "mae_dtheta": 0.01065254956483841,
      "mae_dx": 0.001840302487835288,
      "mae_dy": 0.0020225143525749445,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.42478516697883606,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 169.00926208496094,
      "model/head/act_norm_mean": 113.85965119949495,
      "model/head/act_norm_min": 60.41517639160156,
      "model/head/act_over_embed": 78.2454182751421,
      "model/head/grad_frac": 0.11632068455219269,
      "model/head/grad_norm": 0.04941130056977272,
      "model/head/grad_zero_frac": 0.00019575668557081372,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7060448232323232,
      "model/head/update_ratio": 0.0008437657379545271,
      "model/head/weight_delta": 9.071246147155762,
      "model/head/weight_delta_rel": 0.15913653373718262,
      "model/head/weight_norm": 58.560447692871094,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4210435450077057,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42096802578913256,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42089757323265076,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2892931684870434,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10549888014793396,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04481435939669609,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.519566283632287,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014482199912890792,
      "model/modality_embedder.encoders.pose/weight_delta": 2.936063289642334,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09593033790588379,
      "model/modality_embedder.encoders.pose/weight_norm": 30.944440841674805,
      "model/modality_embedder/grad_frac": 0.10549888014793396,
      "model/modality_embedder/grad_norm": 0.04481435939669609,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.519566283632287,
      "model/modality_embedder/update_ratio": 0.0014482199912890792,
      "model/modality_embedder/weight_delta": 2.936063289642334,
      "model/modality_embedder/weight_delta_rel": 0.09593033790588379,
      "model/modality_embedder/weight_norm": 30.944440841674805,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.80857849121094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.998679753888087,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.9591703414917,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.492117406051626,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09037888050079346,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.038391608744859695,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013774513499811292,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3321263790130615,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08498409390449524,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.87148094177246,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.0631332397461,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.016579485329487,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.368367195129395,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.191627631225586,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09120865911245346,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.038744084537029266,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013078582705929875,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.9559338092803955,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10239585489034653,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.624069213867188,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.62543487548828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.888568221901554,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.821943283081055,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.478075816832586,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10019886493682861,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04256299138069153,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013915885938331485,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.188288688659668,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10705676674842834,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.585901260375977,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.36414337158203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.644400352733687,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.35770034790039,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.684700095499828,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10436420887708664,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.044332366436719894,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014858529902994633,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7239229679107666,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09309075772762299,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.836307525634766,
      "model/normalizer/grad_frac": 0.4049249291419983,
      "model/normalizer/grad_norm": 0.17200610041618347,
      "model/normalizer/grad_zero_frac": 0.00021507639030460268,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021913559176027775,
      "model/normalizer/weight_delta": 5.767068386077881,
      "model/normalizer/weight_delta_rel": 0.07427649945020676,
      "model/normalizer/weight_norm": 78.49299621582031,
      "pose_mae_dtheta": 0.0654752179980278,
      "pose_mae_dx": 0.020156418904662132,
      "pose_mae_dy": 0.02286466956138611,
      "pose_rmse_dtheta": 0.172397181391716,
      "pose_rmse_dx": 0.05491063371300697,
      "pose_rmse_dy": 0.05643288791179657,
      "pose_rmse_mean": 0.09458023309707642,
      "rmse_dtheta": 0.025806598365306854,
      "rmse_dx": 0.0053031546995043755,
      "rmse_dy": 0.00503687234595418,
      "rmse_mean": 0.012048875913023949,
      "rotation_flip": 0.008352668024599552,
      "sparse_tokens": 32105.0,
      "step": 6275,
      "turn_loss": 0.09274975210428238,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30077.0,
      "epoch": 0.2915814904292882,
      "grad_norm": 0.47192326188087463,
      "learning_rate": 4.715876018379714e-06,
      "loss": 0.1417,
      "mae_dtheta": 0.039511337876319885,
      "mae_dx": 0.010470909997820854,
      "mae_dy": 0.003953136503696442,
      "pose_mae_dtheta": 0.3057645559310913,
      "pose_mae_dx": 0.07711772620677948,
      "pose_mae_dy": 0.04807000607252121,
      "pose_rmse_dtheta": 0.5512226819992065,
      "pose_rmse_dx": 0.16863875091075897,
      "pose_rmse_dy": 0.10906398296356201,
      "pose_rmse_mean": 0.27630847692489624,
      "rmse_dtheta": 0.058481428772211075,
      "rmse_dx": 0.02171534113585949,
      "rmse_dy": 0.008110499009490013,
      "rmse_mean": 0.02943575754761696,
      "rotation_flip": 0.008148147724568844,
      "sparse_tokens": 23485.0,
      "step": 6276,
      "turn_loss": 0.2687707245349884,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.291627950195131,
      "grad_norm": 0.46347877383232117,
      "learning_rate": 4.71455594568616e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.027385443449020386,
      "mae_dx": 0.010418446734547615,
      "mae_dy": 0.0026497566141188145,
      "pose_mae_dtheta": 0.20811548829078674,
      "pose_mae_dx": 0.07735331356525421,
      "pose_mae_dy": 0.03384384512901306,
      "pose_rmse_dtheta": 0.41012871265411377,
      "pose_rmse_dx": 0.17125776410102844,
      "pose_rmse_dy": 0.07171273976564407,
      "pose_rmse_mean": 0.21769973635673523,
      "rmse_dtheta": 0.04574019834399223,
      "rmse_dx": 0.021141404286026955,
      "rmse_dy": 0.005791206378489733,
      "rmse_mean": 0.02422427199780941,
      "rotation_flip": 0.008717309683561325,
      "sparse_tokens": 14791.0,
      "step": 6277,
      "turn_loss": 0.2172945737838745,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.2916744099609738,
      "grad_norm": 0.781782329082489,
      "learning_rate": 4.7132358929538635e-06,
      "loss": 0.1682,
      "mae_dtheta": 0.019894052296876907,
      "mae_dx": 0.011276471428573132,
      "mae_dy": 0.004860604647547007,
      "pose_mae_dtheta": 0.12104015797376633,
      "pose_mae_dx": 0.0875178799033165,
      "pose_mae_dy": 0.06681015342473984,
      "pose_rmse_dtheta": 0.19673898816108704,
      "pose_rmse_dx": 0.22417737543582916,
      "pose_rmse_dy": 0.13476641476154327,
      "pose_rmse_mean": 0.18522760272026062,
      "rmse_dtheta": 0.031363941729068756,
      "rmse_dx": 0.024499233812093735,
      "rmse_dy": 0.0080283023416996,
      "rmse_mean": 0.021297160536050797,
      "rotation_flip": 0.013513513840734959,
      "sparse_tokens": 5334.0,
      "step": 6278,
      "turn_loss": 0.20197580754756927,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2917208697268166,
      "grad_norm": 0.4170890748500824,
      "learning_rate": 4.711915860275135e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.008169061504304409,
      "mae_dx": 0.001583161880262196,
      "mae_dy": 0.0017960554687306285,
      "pose_mae_dtheta": 0.056019991636276245,
      "pose_mae_dx": 0.01913709193468094,
      "pose_mae_dy": 0.02482389099895954,
      "pose_rmse_dtheta": 0.13956734538078308,
      "pose_rmse_dx": 0.04688500985503197,
      "pose_rmse_dy": 0.05633566901087761,
      "pose_rmse_mean": 0.08092934638261795,
      "rmse_dtheta": 0.01792457513511181,
      "rmse_dx": 0.004751968197524548,
      "rmse_dy": 0.003823439823463559,
      "rmse_mean": 0.008833328261971474,
      "rotation_flip": 0.005835765041410923,
      "sparse_tokens": 32105.0,
      "step": 6279,
      "turn_loss": 0.08281935751438141,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.2917673294926594,
      "grad_norm": 0.6001157164573669,
      "learning_rate": 4.710595847742284e-06,
      "loss": 0.1508,
      "mae_dtheta": 0.036207523196935654,
      "mae_dx": 0.007635930553078651,
      "mae_dy": 0.011307998560369015,
      "pose_mae_dtheta": 0.30030959844589233,
      "pose_mae_dx": 0.07882339507341385,
      "pose_mae_dy": 0.11028945446014404,
      "pose_rmse_dtheta": 0.45081350207328796,
      "pose_rmse_dx": 0.15974654257297516,
      "pose_rmse_dy": 0.2384684681892395,
      "pose_rmse_mean": 0.28300952911376953,
      "rmse_dtheta": 0.05144535005092621,
      "rmse_dx": 0.014653585851192474,
      "rmse_dy": 0.022757498547434807,
      "rmse_mean": 0.02961881272494793,
      "rotation_flip": 0.004878048785030842,
      "sparse_tokens": 6573.0,
      "step": 6280,
      "turn_loss": 0.3474777638912201,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.29181378925850215,
      "grad_norm": 0.5180478692054749,
      "learning_rate": 4.7092758554476215e-06,
      "loss": 0.1444,
      "mae_dtheta": 0.011715508997440338,
      "mae_dx": 0.0020820163190364838,
      "mae_dy": 0.003973806276917458,
      "pose_mae_dtheta": 0.0770169273018837,
      "pose_mae_dx": 0.032314859330654144,
      "pose_mae_dy": 0.03774627298116684,
      "pose_rmse_dtheta": 0.16916382312774658,
      "pose_rmse_dx": 0.09476658701896667,
      "pose_rmse_dy": 0.09271188080310822,
      "pose_rmse_mean": 0.11888077110052109,
      "rmse_dtheta": 0.021956464275717735,
      "rmse_dx": 0.00529166404157877,
      "rmse_dy": 0.00901009514927864,
      "rmse_mean": 0.01208607479929924,
      "rotation_flip": 0.00639204541221261,
      "sparse_tokens": 32057.0,
      "step": 6281,
      "turn_loss": 0.10931431502103806,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.29186024902434493,
      "grad_norm": 0.4993952810764313,
      "learning_rate": 4.707955883483454e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.005760860163718462,
      "mae_dx": 0.0010966960107907653,
      "mae_dy": 0.0006188788684085011,
      "pose_mae_dtheta": 0.04116222262382507,
      "pose_mae_dx": 0.009258432313799858,
      "pose_mae_dy": 0.008385050110518932,
      "pose_rmse_dtheta": 0.17453603446483612,
      "pose_rmse_dx": 0.021742472425103188,
      "pose_rmse_dy": 0.022301271557807922,
      "pose_rmse_mean": 0.07285992801189423,
      "rmse_dtheta": 0.021171810105443,
      "rmse_dx": 0.0031162723898887634,
      "rmse_dy": 0.0013791365781798959,
      "rmse_mean": 0.008555740118026733,
      "rotation_flip": 0.0009583133505657315,
      "sparse_tokens": 32185.0,
      "step": 6282,
      "turn_loss": 0.04065306857228279,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2919067087901877,
      "grad_norm": 0.38405925035476685,
      "learning_rate": 4.706635931942089e-06,
      "loss": 0.0741,
      "mae_dtheta": 0.005412519909441471,
      "mae_dx": 0.0010047699324786663,
      "mae_dy": 0.0009544664062559605,
      "pose_mae_dtheta": 0.03657783567905426,
      "pose_mae_dx": 0.011040299199521542,
      "pose_mae_dy": 0.01444668136537075,
      "pose_rmse_dtheta": 0.09249444305896759,
      "pose_rmse_dx": 0.026424793526530266,
      "pose_rmse_dy": 0.03873828798532486,
      "pose_rmse_mean": 0.052552513778209686,
      "rmse_dtheta": 0.01548154279589653,
      "rmse_dx": 0.0029200788121670485,
      "rmse_dy": 0.0020344918593764305,
      "rmse_mean": 0.00681203743442893,
      "rotation_flip": 0.00186741363722831,
      "sparse_tokens": 32137.0,
      "step": 6283,
      "turn_loss": 0.041849568486213684,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2919531685560305,
      "grad_norm": 0.4247772991657257,
      "learning_rate": 4.705316000915831e-06,
      "loss": 0.1323,
      "mae_dtheta": 0.010636021383106709,
      "mae_dx": 0.0019426936050876975,
      "mae_dy": 0.002856589388102293,
      "pose_mae_dtheta": 0.07734620571136475,
      "pose_mae_dx": 0.022818682715296745,
      "pose_mae_dy": 0.031960345804691315,
      "pose_rmse_dtheta": 0.19171194732189178,
      "pose_rmse_dx": 0.06370926648378372,
      "pose_rmse_dy": 0.07464968413114548,
      "pose_rmse_mean": 0.11002364009618759,
      "rmse_dtheta": 0.02350575476884842,
      "rmse_dx": 0.005721295718103647,
      "rmse_dy": 0.007075423374772072,
      "rmse_mean": 0.012100825086236,
      "rotation_flip": 0.006076718680560589,
      "sparse_tokens": 32105.0,
      "step": 6284,
      "turn_loss": 0.09955880045890808,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.29199962832187326,
      "grad_norm": 0.38034647703170776,
      "learning_rate": 4.703996090496981e-06,
      "loss": 0.0768,
      "mae_dtheta": 0.03045845776796341,
      "mae_dx": 0.0058891489170491695,
      "mae_dy": 0.0032315433491021395,
      "pose_mae_dtheta": 0.2586061656475067,
      "pose_mae_dx": 0.039701689034700394,
      "pose_mae_dy": 0.02306636981666088,
      "pose_rmse_dtheta": 0.5273852944374084,
      "pose_rmse_dx": 0.1120503768324852,
      "pose_rmse_dy": 0.07995588332414627,
      "pose_rmse_mean": 0.2397971749305725,
      "rmse_dtheta": 0.054189302027225494,
      "rmse_dx": 0.015690878033638,
      "rmse_dy": 0.010723009705543518,
      "rmse_mean": 0.026867730543017387,
      "rotation_flip": 0.005154639016836882,
      "sparse_tokens": 7662.0,
      "step": 6285,
      "turn_loss": 0.19349154829978943,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.29204608808771604,
      "grad_norm": 0.45406848192214966,
      "learning_rate": 4.7026762007778455e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.008322677575051785,
      "mae_dx": 0.001661995891481638,
      "mae_dy": 0.0019153811736032367,
      "pose_mae_dtheta": 0.053961385041475296,
      "pose_mae_dx": 0.019136963412165642,
      "pose_mae_dy": 0.02268385887145996,
      "pose_rmse_dtheta": 0.12340506166219711,
      "pose_rmse_dx": 0.060347940772771835,
      "pose_rmse_dy": 0.05253042280673981,
      "pose_rmse_mean": 0.07876114547252655,
      "rmse_dtheta": 0.018825963139533997,
      "rmse_dx": 0.006322013679891825,
      "rmse_dy": 0.0050423638895154,
      "rmse_mean": 0.010063447058200836,
      "rotation_flip": 0.004293688107281923,
      "sparse_tokens": 32105.0,
      "step": 6286,
      "turn_loss": 0.08245393633842468,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.2920925478535588,
      "grad_norm": 1.0195157527923584,
      "learning_rate": 4.7013563318507214e-06,
      "loss": 0.2502,
      "mae_dtheta": 0.04061088711023331,
      "mae_dx": 0.009199412539601326,
      "mae_dy": 0.0029691290110349655,
      "pose_mae_dtheta": 0.3480144143104553,
      "pose_mae_dx": 0.07906237244606018,
      "pose_mae_dy": 0.030157361179590225,
      "pose_rmse_dtheta": 0.593392014503479,
      "pose_rmse_dx": 0.20645587146282196,
      "pose_rmse_dy": 0.08551771193742752,
      "pose_rmse_mean": 0.2951218783855438,
      "rmse_dtheta": 0.060172539204359055,
      "rmse_dx": 0.021307824179530144,
      "rmse_dy": 0.007736664731055498,
      "rmse_mean": 0.029739011079072952,
      "rotation_flip": 0.009267060086131096,
      "sparse_tokens": 18639.0,
      "step": 6287,
      "turn_loss": 0.2966647744178772,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2921390076194016,
      "grad_norm": 0.5092535614967346,
      "learning_rate": 4.700036483807911e-06,
      "loss": 0.109,
      "mae_dtheta": 0.00858110748231411,
      "mae_dx": 0.001832947600632906,
      "mae_dy": 0.0022907510865479708,
      "pose_mae_dtheta": 0.05693935230374336,
      "pose_mae_dx": 0.023616686463356018,
      "pose_mae_dy": 0.02431078627705574,
      "pose_rmse_dtheta": 0.15965405106544495,
      "pose_rmse_dx": 0.08536959439516068,
      "pose_rmse_dy": 0.07099129259586334,
      "pose_rmse_mean": 0.10533832013607025,
      "rmse_dtheta": 0.021406546235084534,
      "rmse_dx": 0.006526248995214701,
      "rmse_dy": 0.006434308364987373,
      "rmse_mean": 0.011455701664090157,
      "rotation_flip": 0.010146561078727245,
      "sparse_tokens": 32041.0,
      "step": 6288,
      "turn_loss": 0.07077312469482422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.29218546738524437,
      "grad_norm": 0.6572257876396179,
      "learning_rate": 4.6987166567417085e-06,
      "loss": 0.1197,
      "mae_dtheta": 0.009138735011219978,
      "mae_dx": 0.0016247322782874107,
      "mae_dy": 0.0022664882708340883,
      "pose_mae_dtheta": 0.06437017768621445,
      "pose_mae_dx": 0.021689042448997498,
      "pose_mae_dy": 0.02600129134953022,
      "pose_rmse_dtheta": 0.19165988266468048,
      "pose_rmse_dx": 0.05247103050351143,
      "pose_rmse_dy": 0.05360149219632149,
      "pose_rmse_mean": 0.0992441400885582,
      "rmse_dtheta": 0.022037306800484657,
      "rmse_dx": 0.004775758367031813,
      "rmse_dy": 0.005002290941774845,
      "rmse_mean": 0.010605119168758392,
      "rotation_flip": 0.005249343812465668,
      "sparse_tokens": 32073.0,
      "step": 6289,
      "turn_loss": 0.06484617292881012,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.29223192715108715,
      "grad_norm": 0.4337378144264221,
      "learning_rate": 4.697396850744414e-06,
      "loss": 0.091,
      "mae_dtheta": 0.006353209260851145,
      "mae_dx": 0.0008919145911931992,
      "mae_dy": 0.0014205689076334238,
      "pose_mae_dtheta": 0.04340827837586403,
      "pose_mae_dx": 0.011036740615963936,
      "pose_mae_dy": 0.020525559782981873,
      "pose_rmse_dtheta": 0.10883619636297226,
      "pose_rmse_dx": 0.02441716566681862,
      "pose_rmse_dy": 0.045697685331106186,
      "pose_rmse_mean": 0.05965035408735275,
      "rmse_dtheta": 0.01484690047800541,
      "rmse_dx": 0.0027051453944295645,
      "rmse_dy": 0.0027012042701244354,
      "rmse_mean": 0.006751083768904209,
      "rotation_flip": 0.0009564801584929228,
      "sparse_tokens": 32073.0,
      "step": 6290,
      "turn_loss": 0.04997432604432106,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2922783869169299,
      "grad_norm": 0.6209068298339844,
      "learning_rate": 4.696077065908317e-06,
      "loss": 0.1469,
      "mae_dtheta": 0.009415815584361553,
      "mae_dx": 0.0018370164325460792,
      "mae_dy": 0.0005427859723567963,
      "pose_mae_dtheta": 0.06393987685441971,
      "pose_mae_dx": 0.013198287226259708,
      "pose_mae_dy": 0.004958106204867363,
      "pose_rmse_dtheta": 0.23011937737464905,
      "pose_rmse_dx": 0.036660972982645035,
      "pose_rmse_dy": 0.014332350343465805,
      "pose_rmse_mean": 0.0937042385339737,
      "rmse_dtheta": 0.03033684939146042,
      "rmse_dx": 0.005453981924802065,
      "rmse_dy": 0.0021886725444346666,
      "rmse_mean": 0.012659834697842598,
      "rotation_flip": 0.0012033694656565785,
      "sparse_tokens": 32185.0,
      "step": 6291,
      "turn_loss": 0.0672379583120346,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.2923248466827727,
      "grad_norm": 0.7020419836044312,
      "learning_rate": 4.694757302325715e-06,
      "loss": 0.1337,
      "mae_dtheta": 0.029278913512825966,
      "mae_dx": 0.007270182017236948,
      "mae_dy": 0.0032643419690430164,
      "pose_mae_dtheta": 0.22912491858005524,
      "pose_mae_dx": 0.04830451309680939,
      "pose_mae_dy": 0.04448387771844864,
      "pose_rmse_dtheta": 0.40556636452674866,
      "pose_rmse_dx": 0.10606178641319275,
      "pose_rmse_dy": 0.13859838247299194,
      "pose_rmse_mean": 0.21674218773841858,
      "rmse_dtheta": 0.04766887426376343,
      "rmse_dx": 0.017951995134353638,
      "rmse_dy": 0.008374442346394062,
      "rmse_mean": 0.02466510608792305,
      "rotation_flip": 0.012106537818908691,
      "sparse_tokens": 8121.0,
      "step": 6292,
      "turn_loss": 0.2198168933391571,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 21359.0,
      "epoch": 0.2923713064486155,
      "grad_norm": 0.5949708223342896,
      "learning_rate": 4.693437560088901e-06,
      "loss": 0.1663,
      "mae_dtheta": 0.03825758025050163,
      "mae_dx": 0.013244611211121082,
      "mae_dy": 0.004108321852982044,
      "pose_mae_dtheta": 0.29142463207244873,
      "pose_mae_dx": 0.09804829210042953,
      "pose_mae_dy": 0.05310499295592308,
      "pose_rmse_dtheta": 0.511959433555603,
      "pose_rmse_dx": 0.2252613753080368,
      "pose_rmse_dy": 0.1268668919801712,
      "pose_rmse_mean": 0.2880292534828186,
      "rmse_dtheta": 0.05625489354133606,
      "rmse_dx": 0.025433242321014404,
      "rmse_dy": 0.008013536222279072,
      "rmse_mean": 0.029900558292865753,
      "rotation_flip": 0.016145307570695877,
      "sparse_tokens": 17328.0,
      "step": 6293,
      "turn_loss": 0.2794591784477234,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.29241776621445825,
      "grad_norm": 0.5783454179763794,
      "learning_rate": 4.692117839290161e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.030242502689361572,
      "mae_dx": 0.006662636063992977,
      "mae_dy": 0.003114845370873809,
      "pose_mae_dtheta": 0.21948900818824768,
      "pose_mae_dx": 0.05283590033650398,
      "pose_mae_dy": 0.036595843732357025,
      "pose_rmse_dtheta": 0.4096783399581909,
      "pose_rmse_dx": 0.13546311855316162,
      "pose_rmse_dy": 0.08300836384296417,
      "pose_rmse_mean": 0.2093832790851593,
      "rmse_dtheta": 0.049783363938331604,
      "rmse_dx": 0.01674566976726055,
      "rmse_dy": 0.007052190601825714,
      "rmse_mean": 0.02452707663178444,
      "rotation_flip": 0.016129031777381897,
      "sparse_tokens": 8855.0,
      "step": 6294,
      "turn_loss": 0.20834091305732727,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2924642259803011,
      "grad_norm": 0.5295851230621338,
      "learning_rate": 4.690798140021787e-06,
      "loss": 0.0955,
      "mae_dtheta": 0.011272643692791462,
      "mae_dx": 0.001483912579715252,
      "mae_dy": 0.002601079409942031,
      "pose_mae_dtheta": 0.08133689314126968,
      "pose_mae_dx": 0.02684817649424076,
      "pose_mae_dy": 0.03492758050560951,
      "pose_rmse_dtheta": 0.2137007713317871,
      "pose_rmse_dx": 0.07021032273769379,
      "pose_rmse_dy": 0.09151068329811096,
      "pose_rmse_mean": 0.12514060735702515,
      "rmse_dtheta": 0.02495620958507061,
      "rmse_dx": 0.004294821061193943,
      "rmse_dy": 0.0059091136790812016,
      "rmse_mean": 0.011720049194991589,
      "rotation_flip": 0.0024850894697010517,
      "sparse_tokens": 32041.0,
      "step": 6295,
      "turn_loss": 0.08234237134456635,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.29251068574614386,
      "grad_norm": 0.5088024735450745,
      "learning_rate": 4.689478462376063e-06,
      "loss": 0.1022,
      "mae_dtheta": 0.045154232531785965,
      "mae_dx": 0.013047623448073864,
      "mae_dy": 0.006042935885488987,
      "pose_mae_dtheta": 0.33598801493644714,
      "pose_mae_dx": 0.11968740820884705,
      "pose_mae_dy": 0.05639095604419708,
      "pose_rmse_dtheta": 0.5343433618545532,
      "pose_rmse_dx": 0.2373492270708084,
      "pose_rmse_dy": 0.13192115724086761,
      "pose_rmse_mean": 0.3012045919895172,
      "rmse_dtheta": 0.06352782994508743,
      "rmse_dx": 0.025544047355651855,
      "rmse_dy": 0.012235194444656372,
      "rmse_mean": 0.03376902639865875,
      "rotation_flip": 0.021563341841101646,
      "sparse_tokens": 5887.0,
      "step": 6296,
      "turn_loss": 0.34855562448501587,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.29255714551198664,
      "grad_norm": 0.4368923306465149,
      "learning_rate": 4.688158806445279e-06,
      "loss": 0.0991,
      "mae_dtheta": 0.004480383358895779,
      "mae_dx": 0.0034008410293608904,
      "mae_dy": 0.00024494368699379265,
      "pose_mae_dtheta": 0.034515511244535446,
      "pose_mae_dx": 0.03169355168938637,
      "pose_mae_dy": 0.004002952482551336,
      "pose_rmse_dtheta": 0.16172941029071808,
      "pose_rmse_dx": 0.14135956764221191,
      "pose_rmse_dy": 0.006395758129656315,
      "pose_rmse_mean": 0.10316157341003418,
      "rmse_dtheta": 0.018104253336787224,
      "rmse_dx": 0.013277856633067131,
      "rmse_dy": 0.0004281994479242712,
      "rmse_mean": 0.010603437200188637,
      "rotation_flip": 0.003144653979688883,
      "sparse_tokens": 32041.0,
      "step": 6297,
      "turn_loss": 0.0444968119263649,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.2926036052778294,
      "grad_norm": 0.4983308017253876,
      "learning_rate": 4.686839172321715e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.039067573845386505,
      "mae_dx": 0.011623771861195564,
      "mae_dy": 0.0061302101239562035,
      "pose_mae_dtheta": 0.30306246876716614,
      "pose_mae_dx": 0.10399006307125092,
      "pose_mae_dy": 0.0810968205332756,
      "pose_rmse_dtheta": 0.4876413643360138,
      "pose_rmse_dx": 0.21247102320194244,
      "pose_rmse_dy": 0.16806519031524658,
      "pose_rmse_mean": 0.28939253091812134,
      "rmse_dtheta": 0.05506634712219238,
      "rmse_dx": 0.02324795536696911,
      "rmse_dy": 0.010790719650685787,
      "rmse_mean": 0.029701676219701767,
      "rotation_flip": 0.013035382144153118,
      "sparse_tokens": 18418.0,
      "step": 6298,
      "turn_loss": 0.33492597937583923,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2926500650436722,
      "grad_norm": 0.5298094153404236,
      "learning_rate": 4.685519560097657e-06,
      "loss": 0.1289,
      "mae_dtheta": 0.014226905070245266,
      "mae_dx": 0.0038554708007723093,
      "mae_dy": 0.004003243520855904,
      "pose_mae_dtheta": 0.10451196879148483,
      "pose_mae_dx": 0.03955761343240738,
      "pose_mae_dy": 0.03417106717824936,
      "pose_rmse_dtheta": 0.2752324938774109,
      "pose_rmse_dx": 0.12342192977666855,
      "pose_rmse_dy": 0.08433357626199722,
      "pose_rmse_mean": 0.16099600493907928,
      "rmse_dtheta": 0.03162604197859764,
      "rmse_dx": 0.010241148062050343,
      "rmse_dy": 0.010991266928613186,
      "rmse_mean": 0.017619486898183823,
      "rotation_flip": 0.00771775096654892,
      "sparse_tokens": 32137.0,
      "step": 6299,
      "turn_loss": 0.15298183262348175,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.29269652480951497,
      "grad_norm": 0.6361371278762817,
      "learning_rate": 4.684199969865385e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.03649595007300377,
      "mae_dx": 0.0061230105347931385,
      "mae_dy": 0.006195202469825745,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6361371278762817,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 139.94454956054688,
      "model/head/act_norm_mean": 106.64414469401042,
      "model/head/act_norm_min": 64.5007553100586,
      "model/head/act_over_embed": 73.28685465193692,
      "model/head/grad_frac": 0.10802973806858063,
      "model/head/grad_norm": 0.0687217265367508,
      "model/head/grad_zero_frac": 0.00016942311776801944,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7030843098958334,
      "model/head/update_ratio": 0.0011734588770195842,
      "model/head/weight_delta": 9.084495544433594,
      "model/head/weight_delta_rel": 0.15936896204948425,
      "model/head/weight_norm": 58.563385009765625,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.420999139547348,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.420999139547348,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.420999139547348,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28931455015298063,
      "model/modality_embedder.encoders.pose/grad_frac": 0.112000472843647,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0712476596236229,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0023024114780128,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9363934993743896,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09594112634658813,
      "model/modality_embedder.encoders.pose/weight_norm": 30.94479751586914,
      "model/modality_embedder/grad_frac": 0.112000472843647,
      "model/modality_embedder/grad_norm": 0.0712476596236229,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0023024114780128,
      "model/modality_embedder/weight_delta": 2.9363934993743896,
      "model/modality_embedder/weight_delta_rel": 0.09594112634658813,
      "model/modality_embedder/weight_norm": 30.94479751586914,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.93439483642578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.329737103174605,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.256752014160156,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.032413753741555,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08805911242961884,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0560176707804203,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020097678061574697,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3370401859283447,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08516315370798111,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.87270736694336,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 82.14019012451172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.120902571097883,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.67806625366211,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.576110070306243,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09489983320236206,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.060369305312633514,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002037721686065197,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.9623031616210938,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10261649638414383,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.625883102416992,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.69145202636719,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.698815724206348,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.019133567810059,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.660466761778064,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09407272189855576,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05984314903616905,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00195646402426064,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.195098876953125,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10728543996810913,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.58740234375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.22047424316406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.560691550925927,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.645719528198242,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.93996526105588,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10328344255685806,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06570243090391159,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022019753232598305,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.730656385421753,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09332087635993958,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.83795166015625,
      "model/normalizer/grad_frac": 0.38273507356643677,
      "model/normalizer/grad_norm": 0.24347199499607086,
      "model/normalizer/grad_zero_frac": 0.00019616857753135264,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0031017439905554056,
      "model/normalizer/weight_delta": 5.779797554016113,
      "model/normalizer/weight_delta_rel": 0.07444044947624207,
      "model/normalizer/weight_norm": 78.49519348144531,
      "pose_mae_dtheta": 0.3237929940223694,
      "pose_mae_dx": 0.032797180116176605,
      "pose_mae_dy": 0.07569605857133865,
      "pose_rmse_dtheta": 0.6267065405845642,
      "pose_rmse_dx": 0.09026402980089188,
      "pose_rmse_dy": 0.18682682514190674,
      "pose_rmse_mean": 0.30126580595970154,
      "rmse_dtheta": 0.0610363706946373,
      "rmse_dx": 0.01581449806690216,
      "rmse_dy": 0.01636466011404991,
      "rmse_mean": 0.031071841716766357,
      "rotation_flip": 0.009259259328246117,
      "sparse_tokens": 6055.0,
      "step": 6300,
      "turn_loss": 0.3040071427822113,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.29274298457535775,
      "grad_norm": 0.532021701335907,
      "learning_rate": 4.682880401717178e-06,
      "loss": 0.1258,
      "mae_dtheta": 0.011287273839116096,
      "mae_dx": 0.002031181240454316,
      "mae_dy": 0.002739169169217348,
      "pose_mae_dtheta": 0.07366436719894409,
      "pose_mae_dx": 0.025337206199765205,
      "pose_mae_dy": 0.02751373127102852,
      "pose_rmse_dtheta": 0.19176732003688812,
      "pose_rmse_dx": 0.058402810245752335,
      "pose_rmse_dy": 0.06276915967464447,
      "pose_rmse_mean": 0.10431309789419174,
      "rmse_dtheta": 0.025144094601273537,
      "rmse_dx": 0.0057240803726017475,
      "rmse_dy": 0.006540373899042606,
      "rmse_mean": 0.012469517067074776,
      "rotation_flip": 0.010171869769692421,
      "sparse_tokens": 32121.0,
      "step": 6301,
      "turn_loss": 0.09339109808206558,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.2927894443412005,
      "grad_norm": 0.6106113195419312,
      "learning_rate": 4.6815608557453155e-06,
      "loss": 0.1197,
      "mae_dtheta": 0.006685844622552395,
      "mae_dx": 0.0021705066319555044,
      "mae_dy": 0.0013835856225341558,
      "pose_mae_dtheta": 0.045756999403238297,
      "pose_mae_dx": 0.01780339516699314,
      "pose_mae_dy": 0.015227683819830418,
      "pose_rmse_dtheta": 0.13041280210018158,
      "pose_rmse_dx": 0.047912392765283585,
      "pose_rmse_dy": 0.039923444390296936,
      "pose_rmse_mean": 0.0727495476603508,
      "rmse_dtheta": 0.018335605040192604,
      "rmse_dx": 0.006277480628341436,
      "rmse_dy": 0.004569497425109148,
      "rmse_mean": 0.00972752831876278,
      "rotation_flip": 0.0016956337494775653,
      "sparse_tokens": 32185.0,
      "step": 6302,
      "turn_loss": 0.07726141810417175,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64409.0,
      "epoch": 0.2928359041070433,
      "grad_norm": 0.4752036929130554,
      "learning_rate": 4.680241332042072e-06,
      "loss": 0.0834,
      "mae_dtheta": 0.007598559372127056,
      "mae_dx": 0.00268941605463624,
      "mae_dy": 0.0014033716870471835,
      "pose_mae_dtheta": 0.052699875086545944,
      "pose_mae_dx": 0.027775174006819725,
      "pose_mae_dy": 0.018384844064712524,
      "pose_rmse_dtheta": 0.17060251533985138,
      "pose_rmse_dx": 0.092307448387146,
      "pose_rmse_dy": 0.05230916664004326,
      "pose_rmse_mean": 0.10507303476333618,
      "rmse_dtheta": 0.020278483629226685,
      "rmse_dx": 0.009450058452785015,
      "rmse_dy": 0.0038387898821383715,
      "rmse_mean": 0.011189110577106476,
      "rotation_flip": 0.002102312631905079,
      "sparse_tokens": 32009.0,
      "step": 6303,
      "turn_loss": 0.08023568987846375,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2928823638728861,
      "grad_norm": 0.7993190884590149,
      "learning_rate": 4.678921830699724e-06,
      "loss": 0.1341,
      "mae_dtheta": 0.007335872855037451,
      "mae_dx": 0.0017274392303079367,
      "mae_dy": 0.001218909863382578,
      "pose_mae_dtheta": 0.0478113517165184,
      "pose_mae_dx": 0.015273301862180233,
      "pose_mae_dy": 0.015660598874092102,
      "pose_rmse_dtheta": 0.11845402419567108,
      "pose_rmse_dx": 0.044898826628923416,
      "pose_rmse_dy": 0.03743089362978935,
      "pose_rmse_mean": 0.06692791730165482,
      "rmse_dtheta": 0.017185499891638756,
      "rmse_dx": 0.005644998513162136,
      "rmse_dy": 0.002497222740203142,
      "rmse_mean": 0.008442573249340057,
      "rotation_flip": 0.007759456988424063,
      "sparse_tokens": 32153.0,
      "step": 6304,
      "turn_loss": 0.06293776631355286,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.29292882363872885,
      "grad_norm": 0.8860629796981812,
      "learning_rate": 4.677602351810547e-06,
      "loss": 0.2873,
      "mae_dtheta": 0.02693282440304756,
      "mae_dx": 0.00856056623160839,
      "mae_dy": 0.00428457697853446,
      "pose_mae_dtheta": 0.20274651050567627,
      "pose_mae_dx": 0.06708867847919464,
      "pose_mae_dy": 0.044998519122600555,
      "pose_rmse_dtheta": 0.3316495716571808,
      "pose_rmse_dx": 0.13062463700771332,
      "pose_rmse_dy": 0.08421099931001663,
      "pose_rmse_mean": 0.18216173350811005,
      "rmse_dtheta": 0.04033048823475838,
      "rmse_dx": 0.017751676961779594,
      "rmse_dy": 0.007577500306069851,
      "rmse_mean": 0.0218865554779768,
      "rotation_flip": 0.01146788988262415,
      "sparse_tokens": 7505.0,
      "step": 6305,
      "turn_loss": 0.2303159087896347,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.29297528340457163,
      "grad_norm": 0.3839215636253357,
      "learning_rate": 4.676282895466807e-06,
      "loss": 0.097,
      "mae_dtheta": 0.009168005548417568,
      "mae_dx": 0.002638963982462883,
      "mae_dy": 0.0025710768532007933,
      "pose_mae_dtheta": 0.05958685278892517,
      "pose_mae_dx": 0.025643477216362953,
      "pose_mae_dy": 0.03320671245455742,
      "pose_rmse_dtheta": 0.10655266046524048,
      "pose_rmse_dx": 0.06411959230899811,
      "pose_rmse_dy": 0.0772012323141098,
      "pose_rmse_mean": 0.08262449502944946,
      "rmse_dtheta": 0.01836743764579296,
      "rmse_dx": 0.008097493089735508,
      "rmse_dy": 0.005692093167454004,
      "rmse_mean": 0.01071900874376297,
      "rotation_flip": 0.00677845161408186,
      "sparse_tokens": 32089.0,
      "step": 6306,
      "turn_loss": 0.1187756359577179,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.2930217431704144,
      "grad_norm": 0.5857551693916321,
      "learning_rate": 4.674963461760782e-06,
      "loss": 0.1588,
      "mae_dtheta": 0.011346003971993923,
      "mae_dx": 0.0019192887702956796,
      "mae_dy": 0.002908972790464759,
      "pose_mae_dtheta": 0.07455220818519592,
      "pose_mae_dx": 0.027115173637866974,
      "pose_mae_dy": 0.032601356506347656,
      "pose_rmse_dtheta": 0.15726901590824127,
      "pose_rmse_dx": 0.06780286878347397,
      "pose_rmse_dy": 0.07248552143573761,
      "pose_rmse_mean": 0.09918580949306488,
      "rmse_dtheta": 0.022354919463396072,
      "rmse_dx": 0.005680025089532137,
      "rmse_dy": 0.005694370251148939,
      "rmse_mean": 0.011243104934692383,
      "rotation_flip": 0.00548646692186594,
      "sparse_tokens": 32057.0,
      "step": 6307,
      "turn_loss": 0.10571054369211197,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2930682029362572,
      "grad_norm": 0.5431950092315674,
      "learning_rate": 4.673644050784733e-06,
      "loss": 0.1427,
      "mae_dtheta": 0.01374494843184948,
      "mae_dx": 0.0021259766072034836,
      "mae_dy": 0.0024392888881266117,
      "pose_mae_dtheta": 0.09012259542942047,
      "pose_mae_dx": 0.024183504283428192,
      "pose_mae_dy": 0.03038092702627182,
      "pose_rmse_dtheta": 0.21728429198265076,
      "pose_rmse_dx": 0.060760993510484695,
      "pose_rmse_dy": 0.07280126214027405,
      "pose_rmse_mean": 0.11694885790348053,
      "rmse_dtheta": 0.02716692164540291,
      "rmse_dx": 0.0063199326395988464,
      "rmse_dy": 0.004995505325496197,
      "rmse_mean": 0.012827454134821892,
      "rotation_flip": 0.011664074845612049,
      "sparse_tokens": 32121.0,
      "step": 6308,
      "turn_loss": 0.1215103417634964,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.29311466270209996,
      "grad_norm": 0.5639808773994446,
      "learning_rate": 4.672324662630933e-06,
      "loss": 0.1206,
      "mae_dtheta": 0.015239283442497253,
      "mae_dx": 0.0027931728400290012,
      "mae_dy": 0.004607090726494789,
      "pose_mae_dtheta": 0.11447150260210037,
      "pose_mae_dx": 0.02723287232220173,
      "pose_mae_dy": 0.045143529772758484,
      "pose_rmse_dtheta": 0.30695590376853943,
      "pose_rmse_dx": 0.06262299418449402,
      "pose_rmse_dy": 0.1095714420080185,
      "pose_rmse_mean": 0.15971678495407104,
      "rmse_dtheta": 0.031560901552438736,
      "rmse_dx": 0.009729121811687946,
      "rmse_dy": 0.010987893678247929,
      "rmse_mean": 0.01742597296833992,
      "rotation_flip": 0.007949652150273323,
      "sparse_tokens": 32121.0,
      "step": 6309,
      "turn_loss": 0.14693163335323334,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.29316112246794274,
      "grad_norm": 0.4990088641643524,
      "learning_rate": 4.671005297391643e-06,
      "loss": 0.1002,
      "mae_dtheta": 0.009050323627889156,
      "mae_dx": 0.0019178595393896103,
      "mae_dy": 0.002124908845871687,
      "pose_mae_dtheta": 0.05607021227478981,
      "pose_mae_dx": 0.02143983170390129,
      "pose_mae_dy": 0.024676837027072906,
      "pose_rmse_dtheta": 0.1563536822795868,
      "pose_rmse_dx": 0.05618017911911011,
      "pose_rmse_dy": 0.05250395089387894,
      "pose_rmse_mean": 0.08834593743085861,
      "rmse_dtheta": 0.020266380161046982,
      "rmse_dx": 0.005614561960101128,
      "rmse_dy": 0.004991986323148012,
      "rmse_mean": 0.010290976613759995,
      "rotation_flip": 0.0028070176485925913,
      "sparse_tokens": 32105.0,
      "step": 6310,
      "turn_loss": 0.0876147598028183,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.29320758223378557,
      "grad_norm": 0.6078369617462158,
      "learning_rate": 4.66968595515913e-06,
      "loss": 0.1872,
      "mae_dtheta": 0.011355393566191196,
      "mae_dx": 0.0013625114224851131,
      "mae_dy": 0.0025436573196202517,
      "pose_mae_dtheta": 0.0648079589009285,
      "pose_mae_dx": 0.020039983093738556,
      "pose_mae_dy": 0.03152736276388168,
      "pose_rmse_dtheta": 0.13037866353988647,
      "pose_rmse_dx": 0.047199707478284836,
      "pose_rmse_dy": 0.0647786483168602,
      "pose_rmse_mean": 0.08078567683696747,
      "rmse_dtheta": 0.021340034902095795,
      "rmse_dx": 0.004476831294596195,
      "rmse_dy": 0.005173149518668652,
      "rmse_mean": 0.010330005548894405,
      "rotation_flip": 0.008989572525024414,
      "sparse_tokens": 32041.0,
      "step": 6311,
      "turn_loss": 0.0828346461057663,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.29325404199962835,
      "grad_norm": 0.3965274393558502,
      "learning_rate": 4.668366636025657e-06,
      "loss": 0.1058,
      "mae_dtheta": 0.01339430920779705,
      "mae_dx": 0.0017860402585938573,
      "mae_dy": 0.0029679930303245783,
      "pose_mae_dtheta": 0.09161322563886642,
      "pose_mae_dx": 0.027097756043076515,
      "pose_mae_dy": 0.046157076954841614,
      "pose_rmse_dtheta": 0.1953991949558258,
      "pose_rmse_dx": 0.0724014863371849,
      "pose_rmse_dy": 0.1163475289940834,
      "pose_rmse_mean": 0.12804940342903137,
      "rmse_dtheta": 0.025248071178793907,
      "rmse_dx": 0.006059180945158005,
      "rmse_dy": 0.006570525001734495,
      "rmse_mean": 0.012625925242900848,
      "rotation_flip": 0.01064668782055378,
      "sparse_tokens": 32041.0,
      "step": 6312,
      "turn_loss": 0.10813415050506592,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.2933005017654711,
      "grad_norm": 0.5291873216629028,
      "learning_rate": 4.667047340083481e-06,
      "loss": 0.1187,
      "mae_dtheta": 0.03262147307395935,
      "mae_dx": 0.009297854267060757,
      "mae_dy": 0.0039826491847634315,
      "pose_mae_dtheta": 0.25597456097602844,
      "pose_mae_dx": 0.0689578428864479,
      "pose_mae_dy": 0.04002980515360832,
      "pose_rmse_dtheta": 0.4553171694278717,
      "pose_rmse_dx": 0.16063205897808075,
      "pose_rmse_dy": 0.09156477451324463,
      "pose_rmse_mean": 0.23583799600601196,
      "rmse_dtheta": 0.05150638893246651,
      "rmse_dx": 0.019245805218815804,
      "rmse_dy": 0.0091640530154109,
      "rmse_mean": 0.026638749986886978,
      "rotation_flip": 0.008797653950750828,
      "sparse_tokens": 5509.0,
      "step": 6313,
      "turn_loss": 0.22512149810791016,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 16189.0,
      "epoch": 0.2933469615313139,
      "grad_norm": 0.7160223722457886,
      "learning_rate": 4.665728067424865e-06,
      "loss": 0.1553,
      "mae_dtheta": 0.033795345574617386,
      "mae_dx": 0.013517248444259167,
      "mae_dy": 0.003995924256742001,
      "pose_mae_dtheta": 0.28865110874176025,
      "pose_mae_dx": 0.12256456911563873,
      "pose_mae_dy": 0.07637473940849304,
      "pose_rmse_dtheta": 0.5070458650588989,
      "pose_rmse_dx": 0.29983198642730713,
      "pose_rmse_dy": 0.1603497415781021,
      "pose_rmse_mean": 0.3224092125892639,
      "rmse_dtheta": 0.05106854438781738,
      "rmse_dx": 0.028783630579710007,
      "rmse_dy": 0.00703174713999033,
      "rmse_mean": 0.028961308300495148,
      "rotation_flip": 0.007800311781466007,
      "sparse_tokens": 12450.0,
      "step": 6314,
      "turn_loss": 0.19905300438404083,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.2933934212971567,
      "grad_norm": 0.44261953234672546,
      "learning_rate": 4.664408818142063e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.03454543277621269,
      "mae_dx": 0.008584583178162575,
      "mae_dy": 0.004498687572777271,
      "pose_mae_dtheta": 0.27511245012283325,
      "pose_mae_dx": 0.05632663890719414,
      "pose_mae_dy": 0.033343296498060226,
      "pose_rmse_dtheta": 0.511162281036377,
      "pose_rmse_dx": 0.11989064514636993,
      "pose_rmse_dy": 0.07998098433017731,
      "pose_rmse_mean": 0.23701129853725433,
      "rmse_dtheta": 0.05683644860982895,
      "rmse_dx": 0.018070556223392487,
      "rmse_dy": 0.010532716289162636,
      "rmse_mean": 0.028479907661676407,
      "rotation_flip": 0.0164930559694767,
      "sparse_tokens": 19192.0,
      "step": 6315,
      "turn_loss": 0.23236168920993805,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.29343988106299945,
      "grad_norm": 0.4745250940322876,
      "learning_rate": 4.663089592327333e-06,
      "loss": 0.089,
      "mae_dtheta": 0.009098331443965435,
      "mae_dx": 0.0024283090606331825,
      "mae_dy": 0.0016848371597006917,
      "pose_mae_dtheta": 0.06426659971475601,
      "pose_mae_dx": 0.024780530482530594,
      "pose_mae_dy": 0.024117140099406242,
      "pose_rmse_dtheta": 0.17915181815624237,
      "pose_rmse_dx": 0.08804552257061005,
      "pose_rmse_dy": 0.06108507141470909,
      "pose_rmse_mean": 0.10942747443914413,
      "rmse_dtheta": 0.021010255441069603,
      "rmse_dx": 0.008918238803744316,
      "rmse_dy": 0.0037338733673095703,
      "rmse_mean": 0.011220789514482021,
      "rotation_flip": 0.006639427971094847,
      "sparse_tokens": 32057.0,
      "step": 6316,
      "turn_loss": 0.07919682562351227,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.29348634082884223,
      "grad_norm": 0.48514148592948914,
      "learning_rate": 4.661770390072929e-06,
      "loss": 0.096,
      "mae_dtheta": 0.008096889592707157,
      "mae_dx": 0.0017315185396000743,
      "mae_dy": 0.000976501265540719,
      "pose_mae_dtheta": 0.05795698240399361,
      "pose_mae_dx": 0.01648162305355072,
      "pose_mae_dy": 0.014860415831208229,
      "pose_rmse_dtheta": 0.2107967883348465,
      "pose_rmse_dx": 0.049253251403570175,
      "pose_rmse_dy": 0.05038675665855408,
      "pose_rmse_mean": 0.10347893089056015,
      "rmse_dtheta": 0.02525428868830204,
      "rmse_dx": 0.006010035984218121,
      "rmse_dy": 0.0028440107125788927,
      "rmse_mean": 0.01136944442987442,
      "rotation_flip": 0.0021536252461373806,
      "sparse_tokens": 32121.0,
      "step": 6317,
      "turn_loss": 0.05379907041788101,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9435.0,
      "epoch": 0.293532800594685,
      "grad_norm": 0.45807674527168274,
      "learning_rate": 4.6604512114711035e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.0150744104757905,
      "mae_dx": 0.004377768840640783,
      "mae_dy": 0.004905241075903177,
      "pose_mae_dtheta": 0.1067301332950592,
      "pose_mae_dx": 0.03245329484343529,
      "pose_mae_dy": 0.06442059576511383,
      "pose_rmse_dtheta": 0.23969905078411102,
      "pose_rmse_dx": 0.1039765477180481,
      "pose_rmse_dy": 0.23954908549785614,
      "pose_rmse_mean": 0.19440823793411255,
      "rmse_dtheta": 0.03399680554866791,
      "rmse_dx": 0.012508129701018333,
      "rmse_dy": 0.01647428795695305,
      "rmse_mean": 0.020993074402213097,
      "rotation_flip": 0.016736401244997978,
      "sparse_tokens": 7834.0,
      "step": 6318,
      "turn_loss": 0.18248768150806427,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.2935792603605278,
      "grad_norm": 0.47802942991256714,
      "learning_rate": 4.659132056614108e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.016156814992427826,
      "mae_dx": 0.0036407974548637867,
      "mae_dy": 0.003989298827946186,
      "pose_mae_dtheta": 0.09841421246528625,
      "pose_mae_dx": 0.030270030722022057,
      "pose_mae_dy": 0.06733544915914536,
      "pose_rmse_dtheta": 0.15871185064315796,
      "pose_rmse_dx": 0.0787387490272522,
      "pose_rmse_dy": 0.11726886034011841,
      "pose_rmse_mean": 0.11823982000350952,
      "rmse_dtheta": 0.024532809853553772,
      "rmse_dx": 0.012843352742493153,
      "rmse_dy": 0.005737222731113434,
      "rmse_mean": 0.014371128752827644,
      "rotation_flip": 0.009852216579020023,
      "sparse_tokens": 4604.0,
      "step": 6319,
      "turn_loss": 0.1896449774503708,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.29362572012637056,
      "grad_norm": 0.5321672558784485,
      "learning_rate": 4.657812925594188e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.009367236867547035,
      "mae_dx": 0.0013316917465999722,
      "mae_dy": 0.001908017904497683,
      "pose_mae_dtheta": 0.06211027503013611,
      "pose_mae_dx": 0.017416927963495255,
      "pose_mae_dy": 0.023433197289705276,
      "pose_rmse_dtheta": 0.1775573194026947,
      "pose_rmse_dx": 0.05768287926912308,
      "pose_rmse_dy": 0.07890360057353973,
      "pose_rmse_mean": 0.10471459478139877,
      "rmse_dtheta": 0.023770160973072052,
      "rmse_dx": 0.004823158495128155,
      "rmse_dy": 0.005687696859240532,
      "rmse_mean": 0.011427005752921104,
      "rotation_flip": 0.0043691969476640224,
      "sparse_tokens": 32057.0,
      "step": 6320,
      "turn_loss": 0.06740212440490723,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.29367217989221334,
      "grad_norm": 0.6190304160118103,
      "learning_rate": 4.6564938185035954e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.008157040923833847,
      "mae_dx": 0.001700514112599194,
      "mae_dy": 0.0012973773991689086,
      "pose_mae_dtheta": 0.06060962751507759,
      "pose_mae_dx": 0.015373220667243004,
      "pose_mae_dy": 0.014556641690433025,
      "pose_rmse_dtheta": 0.21822956204414368,
      "pose_rmse_dx": 0.05455441400408745,
      "pose_rmse_dy": 0.03884533792734146,
      "pose_rmse_mean": 0.10387643426656723,
      "rmse_dtheta": 0.02545681595802307,
      "rmse_dx": 0.005841696169227362,
      "rmse_dy": 0.004591130185872316,
      "rmse_mean": 0.011963213793933392,
      "rotation_flip": 0.006736068520694971,
      "sparse_tokens": 32105.0,
      "step": 6321,
      "turn_loss": 0.06595148146152496,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.2937186396580561,
      "grad_norm": 0.5162328481674194,
      "learning_rate": 4.655174735434575e-06,
      "loss": 0.114,
      "mae_dtheta": 0.032218728214502335,
      "mae_dx": 0.013169543817639351,
      "mae_dy": 0.0059897820465266705,
      "pose_mae_dtheta": 0.24625808000564575,
      "pose_mae_dx": 0.09993774443864822,
      "pose_mae_dy": 0.05592615529894829,
      "pose_rmse_dtheta": 0.4933463931083679,
      "pose_rmse_dx": 0.22915050387382507,
      "pose_rmse_dy": 0.14108014106750488,
      "pose_rmse_mean": 0.2878590226173401,
      "rmse_dtheta": 0.053539447486400604,
      "rmse_dx": 0.026697752997279167,
      "rmse_dy": 0.01363124419003725,
      "rmse_mean": 0.0312894843518734,
      "rotation_flip": 0.013498312793672085,
      "sparse_tokens": 16913.0,
      "step": 6322,
      "turn_loss": 0.2621656060218811,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.2937650994238989,
      "grad_norm": 0.38009822368621826,
      "learning_rate": 4.653855676479368e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.03213321417570114,
      "mae_dx": 0.01470921840518713,
      "mae_dy": 0.005873437505215406,
      "pose_mae_dtheta": 0.25042468309402466,
      "pose_mae_dx": 0.1173241063952446,
      "pose_mae_dy": 0.06479867547750473,
      "pose_rmse_dtheta": 0.45125919580459595,
      "pose_rmse_dx": 0.25052133202552795,
      "pose_rmse_dy": 0.14358018338680267,
      "pose_rmse_mean": 0.2817869186401367,
      "rmse_dtheta": 0.04993117228150368,
      "rmse_dx": 0.027936898171901703,
      "rmse_dy": 0.010292434133589268,
      "rmse_mean": 0.029386837035417557,
      "rotation_flip": 0.012621358968317509,
      "sparse_tokens": 17182.0,
      "step": 6323,
      "turn_loss": 0.23436912894248962,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.29381155918974167,
      "grad_norm": 0.3720857799053192,
      "learning_rate": 4.652536641730222e-06,
      "loss": 0.105,
      "mae_dtheta": 0.0072065116837620735,
      "mae_dx": 0.0012448769994080067,
      "mae_dy": 0.0011972689535468817,
      "pose_mae_dtheta": 0.044971615076065063,
      "pose_mae_dx": 0.013279914855957031,
      "pose_mae_dy": 0.016002148389816284,
      "pose_rmse_dtheta": 0.13880035281181335,
      "pose_rmse_dx": 0.03354569151997566,
      "pose_rmse_dy": 0.0394643135368824,
      "pose_rmse_mean": 0.07060345262289047,
      "rmse_dtheta": 0.019527696073055267,
      "rmse_dx": 0.004090467002242804,
      "rmse_dy": 0.002596238860860467,
      "rmse_mean": 0.008738134056329727,
      "rotation_flip": 0.002575991675257683,
      "sparse_tokens": 32073.0,
      "step": 6324,
      "turn_loss": 0.06291726976633072,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.29385801895558444,
      "grad_norm": 0.4139139652252197,
      "learning_rate": 4.651217631279374e-06,
      "loss": 0.0765,
      "mae_dtheta": 0.00950599741190672,
      "mae_dx": 0.001979457214474678,
      "mae_dy": 0.0019491261336952448,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4139139652252197,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.1092529296875,
      "model/head/act_norm_mean": 125.00359059343434,
      "model/head/act_norm_min": 53.455528259277344,
      "model/head/act_over_embed": 85.90363775786162,
      "model/head/grad_frac": 0.0934649184346199,
      "model/head/grad_norm": 0.03868643566966057,
      "model/head/grad_zero_frac": 0.00020749573013745248,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6945085621843434,
      "model/head/update_ratio": 0.0006605634116567671,
      "model/head/weight_delta": 9.09746265411377,
      "model/head/weight_delta_rel": 0.15959644317626953,
      "model/head/weight_norm": 58.565818786621094,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4211249053478241,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42104561423415127,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42098310589790344,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28934648799285473,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09091900289058685,
      "model/modality_embedder.encoders.pose/grad_norm": 0.037632644176483154,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5360768860132159,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012160846963524818,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9414353370666504,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09610585868358612,
      "model/modality_embedder.encoders.pose/weight_norm": 30.945743560791016,
      "model/modality_embedder/grad_frac": 0.09091900289058685,
      "model/modality_embedder/grad_norm": 0.037632644176483154,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5360768860132159,
      "model/modality_embedder/update_ratio": 0.0012160846963524818,
      "model/modality_embedder/weight_delta": 2.9414353370666504,
      "model/modality_embedder/weight_delta_rel": 0.09610585868358612,
      "model/modality_embedder/weight_norm": 30.945743560791016,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 94.93791198730469,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.115129469296136,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.088297843933105,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.259352102846954,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05921727791428566,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.024510858580470085,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008793461020104587,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.342669725418091,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08536829799413681,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.873960494995117,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 96.66896057128906,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.174382716049383,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.251669883728027,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.987280850900923,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06666338443756104,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02759290672838688,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009313289192505181,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.969456195831299,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10286428034305573,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.627456665039062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 98.71166229248047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.063564714606382,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.318140983581543,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.285544407109825,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07272854447364807,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03010336123406887,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009841076098382473,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.202349901199341,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10752891004085541,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.589500427246094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 99.31815338134766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.76556988536155,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.383026123046875,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.455178294876237,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07880911231040955,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03262019157409668,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010931841097772121,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.736722469329834,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09352818876504898,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.839614868164062,
      "model/normalizer/grad_frac": 0.2819366157054901,
      "model/normalizer/grad_norm": 0.11669749766588211,
      "model/normalizer/grad_zero_frac": 0.00017017032951116562,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014866463607177138,
      "model/normalizer/weight_delta": 5.793076992034912,
      "model/normalizer/weight_delta_rel": 0.07461147755384445,
      "model/normalizer/weight_norm": 78.49714660644531,
      "pose_mae_dtheta": 0.0749305933713913,
      "pose_mae_dx": 0.01724814996123314,
      "pose_mae_dy": 0.01718556322157383,
      "pose_rmse_dtheta": 0.2421845644712448,
      "pose_rmse_dx": 0.04832219332456589,
      "pose_rmse_dy": 0.047105852514505386,
      "pose_rmse_mean": 0.11253753304481506,
      "rmse_dtheta": 0.026642099022865295,
      "rmse_dx": 0.007023837883025408,
      "rmse_dy": 0.006781819276511669,
      "rmse_mean": 0.013482585549354553,
      "rotation_flip": 0.005464480724185705,
      "sparse_tokens": 32137.0,
      "step": 6325,
      "turn_loss": 0.0711577907204628,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.2939044787214272,
      "grad_norm": 0.35851362347602844,
      "learning_rate": 4.649898645219065e-06,
      "loss": 0.0723,
      "mae_dtheta": 0.033240970224142075,
      "mae_dx": 0.00710706552490592,
      "mae_dy": 0.013700325042009354,
      "pose_mae_dtheta": 0.28415167331695557,
      "pose_mae_dx": 0.07117624580860138,
      "pose_mae_dy": 0.1362346112728119,
      "pose_rmse_dtheta": 0.5127969980239868,
      "pose_rmse_dx": 0.14190047979354858,
      "pose_rmse_dy": 0.25122877955436707,
      "pose_rmse_mean": 0.30197542905807495,
      "rmse_dtheta": 0.05088317394256592,
      "rmse_dx": 0.013029729016125202,
      "rmse_dy": 0.02654869854450226,
      "rmse_mean": 0.030153868719935417,
      "rotation_flip": 0.013605441898107529,
      "sparse_tokens": 4990.0,
      "step": 6326,
      "turn_loss": 0.34000441431999207,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.29395093848727,
      "grad_norm": 0.5118710398674011,
      "learning_rate": 4.64857968364153e-06,
      "loss": 0.1738,
      "mae_dtheta": 0.034046150743961334,
      "mae_dx": 0.01292900275439024,
      "mae_dy": 0.004185928497463465,
      "pose_mae_dtheta": 0.2660834789276123,
      "pose_mae_dx": 0.10095912218093872,
      "pose_mae_dy": 0.0479283332824707,
      "pose_rmse_dtheta": 0.4593372046947479,
      "pose_rmse_dx": 0.221052885055542,
      "pose_rmse_dy": 0.11245108395814896,
      "pose_rmse_mean": 0.26428040862083435,
      "rmse_dtheta": 0.05102059990167618,
      "rmse_dx": 0.02526351809501648,
      "rmse_dy": 0.008575963787734509,
      "rmse_mean": 0.02828669361770153,
      "rotation_flip": 0.012698412872850895,
      "sparse_tokens": 20941.0,
      "step": 6327,
      "turn_loss": 0.29833686351776123,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.29399739825311283,
      "grad_norm": 0.5856691002845764,
      "learning_rate": 4.647260746639009e-06,
      "loss": 0.1854,
      "mae_dtheta": 0.010489623062312603,
      "mae_dx": 0.002009483752772212,
      "mae_dy": 0.0026943543925881386,
      "pose_mae_dtheta": 0.07770124077796936,
      "pose_mae_dx": 0.024313349276781082,
      "pose_mae_dy": 0.02595273219048977,
      "pose_rmse_dtheta": 0.23722055554389954,
      "pose_rmse_dx": 0.06901539117097855,
      "pose_rmse_dy": 0.07259130477905273,
      "pose_rmse_mean": 0.12627574801445007,
      "rmse_dtheta": 0.026041166856884956,
      "rmse_dx": 0.00597327621653676,
      "rmse_dy": 0.007184769958257675,
      "rmse_mean": 0.013066405430436134,
      "rotation_flip": 0.006729475222527981,
      "sparse_tokens": 32073.0,
      "step": 6328,
      "turn_loss": 0.08790335059165955,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10052.0,
      "epoch": 0.2940438580189556,
      "grad_norm": 0.611212432384491,
      "learning_rate": 4.6459418343037305e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.027808260172605515,
      "mae_dx": 0.010918398387730122,
      "mae_dy": 0.0023403624072670937,
      "pose_mae_dtheta": 0.24806956946849823,
      "pose_mae_dx": 0.09561660140752792,
      "pose_mae_dy": 0.04353811591863632,
      "pose_rmse_dtheta": 0.4743839204311371,
      "pose_rmse_dx": 0.2746731638908386,
      "pose_rmse_dy": 0.11921998113393784,
      "pose_rmse_mean": 0.28942567110061646,
      "rmse_dtheta": 0.04908103868365288,
      "rmse_dx": 0.026387056335806847,
      "rmse_dy": 0.0057836975902318954,
      "rmse_mean": 0.027083931490778923,
      "rotation_flip": 0.005390835460275412,
      "sparse_tokens": 7701.0,
      "step": 6329,
      "turn_loss": 0.22928859293460846,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2940903177847984,
      "grad_norm": 0.4162263572216034,
      "learning_rate": 4.6446229467279295e-06,
      "loss": 0.0722,
      "mae_dtheta": 0.006002066191285849,
      "mae_dx": 0.0013351930538192391,
      "mae_dy": 0.00029925224953331053,
      "pose_mae_dtheta": 0.04613684117794037,
      "pose_mae_dx": 0.01051553525030613,
      "pose_mae_dy": 0.00404693465679884,
      "pose_rmse_dtheta": 0.21799413859844208,
      "pose_rmse_dx": 0.02999981679022312,
      "pose_rmse_dy": 0.00964247714728117,
      "pose_rmse_mean": 0.08587881177663803,
      "rmse_dtheta": 0.024974307045340538,
      "rmse_dx": 0.004267074167728424,
      "rmse_dy": 0.0006704999250359833,
      "rmse_mean": 0.009970627725124359,
      "rotation_flip": 0.0029498524963855743,
      "sparse_tokens": 32105.0,
      "step": 6330,
      "turn_loss": 0.03389064222574234,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.29413677755064116,
      "grad_norm": 0.4893942177295685,
      "learning_rate": 4.643304084003839e-06,
      "loss": 0.0826,
      "mae_dtheta": 0.008780707605183125,
      "mae_dx": 0.002164574107155204,
      "mae_dy": 0.001677047461271286,
      "pose_mae_dtheta": 0.059449419379234314,
      "pose_mae_dx": 0.016339339315891266,
      "pose_mae_dy": 0.016740448772907257,
      "pose_rmse_dtheta": 0.1774657964706421,
      "pose_rmse_dx": 0.05010470747947693,
      "pose_rmse_dy": 0.05749112740159035,
      "pose_rmse_mean": 0.09502054750919342,
      "rmse_dtheta": 0.02361247129738331,
      "rmse_dx": 0.006851979065686464,
      "rmse_dy": 0.006724440958350897,
      "rmse_mean": 0.012396297417581081,
      "rotation_flip": 0.0033167495857924223,
      "sparse_tokens": 32201.0,
      "step": 6331,
      "turn_loss": 0.0824102982878685,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.29418323731648394,
      "grad_norm": 0.3261250853538513,
      "learning_rate": 4.6419852462236834e-06,
      "loss": 0.0713,
      "mae_dtheta": 0.007939458824694157,
      "mae_dx": 0.0011448506265878677,
      "mae_dy": 0.001589177642017603,
      "pose_mae_dtheta": 0.049849867820739746,
      "pose_mae_dx": 0.01512543112039566,
      "pose_mae_dy": 0.020140482112765312,
      "pose_rmse_dtheta": 0.12422838062047958,
      "pose_rmse_dx": 0.037680644541978836,
      "pose_rmse_dy": 0.04328237846493721,
      "pose_rmse_mean": 0.06839713454246521,
      "rmse_dtheta": 0.018361659720540047,
      "rmse_dx": 0.00348459929227829,
      "rmse_dy": 0.00314774620346725,
      "rmse_mean": 0.00833133514970541,
      "rotation_flip": 0.003288121661171317,
      "sparse_tokens": 32089.0,
      "step": 6332,
      "turn_loss": 0.057189758867025375,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2942296970823267,
      "grad_norm": 0.45774000883102417,
      "learning_rate": 4.640666433479693e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.008547822013497353,
      "mae_dx": 0.0013643888523802161,
      "mae_dy": 0.0011166430776938796,
      "pose_mae_dtheta": 0.05816365033388138,
      "pose_mae_dx": 0.013713013380765915,
      "pose_mae_dy": 0.013548179529607296,
      "pose_rmse_dtheta": 0.1901697963476181,
      "pose_rmse_dx": 0.033338211476802826,
      "pose_rmse_dy": 0.033284712582826614,
      "pose_rmse_mean": 0.08559757471084595,
      "rmse_dtheta": 0.023970989510416985,
      "rmse_dx": 0.00418482068926096,
      "rmse_dy": 0.0028758395928889513,
      "rmse_mean": 0.010343884117901325,
      "rotation_flip": 0.005907172802835703,
      "sparse_tokens": 32169.0,
      "step": 6333,
      "turn_loss": 0.059121958911418915,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.2942761568481695,
      "grad_norm": 0.4636690020561218,
      "learning_rate": 4.639347645864091e-06,
      "loss": 0.0912,
      "mae_dtheta": 0.023532552644610405,
      "mae_dx": 0.01143023744225502,
      "mae_dy": 0.005699367728084326,
      "pose_mae_dtheta": 0.1695629060268402,
      "pose_mae_dx": 0.08896457403898239,
      "pose_mae_dy": 0.07822483777999878,
      "pose_rmse_dtheta": 0.34050577878952026,
      "pose_rmse_dx": 0.20586125552654266,
      "pose_rmse_dy": 0.19171656668186188,
      "pose_rmse_mean": 0.246027871966362,
      "rmse_dtheta": 0.0403326041996479,
      "rmse_dx": 0.024332813918590546,
      "rmse_dy": 0.013868476264178753,
      "rmse_mean": 0.026177965104579926,
      "rotation_flip": 0.009345794096589088,
      "sparse_tokens": 18266.0,
      "step": 6334,
      "turn_loss": 0.24160489439964294,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.29432261661401227,
      "grad_norm": 0.4177790880203247,
      "learning_rate": 4.638028883469103e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.007469372823834419,
      "mae_dx": 0.001421459368430078,
      "mae_dy": 0.001245036255568266,
      "pose_mae_dtheta": 0.05202225595712662,
      "pose_mae_dx": 0.013538472354412079,
      "pose_mae_dy": 0.015131323598325253,
      "pose_rmse_dtheta": 0.15368454158306122,
      "pose_rmse_dx": 0.03613317012786865,
      "pose_rmse_dy": 0.052433889359235764,
      "pose_rmse_mean": 0.08075053989887238,
      "rmse_dtheta": 0.020344814285635948,
      "rmse_dx": 0.004555274732410908,
      "rmse_dy": 0.0036493793595582247,
      "rmse_mean": 0.009516490623354912,
      "rotation_flip": 0.0039084311574697495,
      "sparse_tokens": 32137.0,
      "step": 6335,
      "turn_loss": 0.056354790925979614,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8787.0,
      "epoch": 0.29436907637985504,
      "grad_norm": 0.5339292883872986,
      "learning_rate": 4.636710146386948e-06,
      "loss": 0.1582,
      "mae_dtheta": 0.02659241296350956,
      "mae_dx": 0.0047628916800022125,
      "mae_dy": 0.005824490450322628,
      "pose_mae_dtheta": 0.1298600435256958,
      "pose_mae_dx": 0.056221265345811844,
      "pose_mae_dy": 0.0760684534907341,
      "pose_rmse_dtheta": 0.18113404512405396,
      "pose_rmse_dx": 0.11757955700159073,
      "pose_rmse_dy": 0.11717694997787476,
      "pose_rmse_mean": 0.13863018155097961,
      "rmse_dtheta": 0.03500525653362274,
      "rmse_dx": 0.013240540400147438,
      "rmse_dy": 0.008702213875949383,
      "rmse_mean": 0.018982671201229095,
      "rotation_flip": 0.007009345572441816,
      "sparse_tokens": 7601.0,
      "step": 6336,
      "turn_loss": 0.2550796866416931,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.2944155361456978,
      "grad_norm": 0.6565231084823608,
      "learning_rate": 4.635391434709847e-06,
      "loss": 0.1412,
      "mae_dtheta": 0.04793643578886986,
      "mae_dx": 0.010692212730646133,
      "mae_dy": 0.0018856832757592201,
      "pose_mae_dtheta": 0.4107782244682312,
      "pose_mae_dx": 0.08560971170663834,
      "pose_mae_dy": 0.026280982419848442,
      "pose_rmse_dtheta": 0.6776096224784851,
      "pose_rmse_dx": 0.1920972317457199,
      "pose_rmse_dy": 0.08251870423555374,
      "pose_rmse_mean": 0.3174085319042206,
      "rmse_dtheta": 0.0685916393995285,
      "rmse_dx": 0.022502470761537552,
      "rmse_dy": 0.004295590333640575,
      "rmse_mean": 0.031796567142009735,
      "rotation_flip": 0.013437850400805473,
      "sparse_tokens": 13961.0,
      "step": 6337,
      "turn_loss": 0.2730661928653717,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2944619959115406,
      "grad_norm": 0.5042619109153748,
      "learning_rate": 4.63407274853002e-06,
      "loss": 0.1306,
      "mae_dtheta": 0.006565388757735491,
      "mae_dx": 0.0017478434601798654,
      "mae_dy": 0.00024795052013359964,
      "pose_mae_dtheta": 0.04894319176673889,
      "pose_mae_dx": 0.013262844644486904,
      "pose_mae_dy": 0.0036001524422317743,
      "pose_rmse_dtheta": 0.21379061043262482,
      "pose_rmse_dx": 0.04135090485215187,
      "pose_rmse_dy": 0.007163397502154112,
      "pose_rmse_mean": 0.08743497729301453,
      "rmse_dtheta": 0.02559913694858551,
      "rmse_dx": 0.005845623556524515,
      "rmse_dy": 0.0005076099769212306,
      "rmse_mean": 0.010650791227817535,
      "rotation_flip": 0.0027322403620928526,
      "sparse_tokens": 32153.0,
      "step": 6338,
      "turn_loss": 0.043838512152433395,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.2945084556773834,
      "grad_norm": 0.3720732629299164,
      "learning_rate": 4.632754087939681e-06,
      "loss": 0.0721,
      "mae_dtheta": 0.005601571872830391,
      "mae_dx": 0.0014508710009977221,
      "mae_dy": 0.0012085343478247523,
      "pose_mae_dtheta": 0.047165244817733765,
      "pose_mae_dx": 0.011329113505780697,
      "pose_mae_dy": 0.013292198069393635,
      "pose_rmse_dtheta": 0.19258928298950195,
      "pose_rmse_dx": 0.04871399328112602,
      "pose_rmse_dy": 0.035604048520326614,
      "pose_rmse_mean": 0.09230244159698486,
      "rmse_dtheta": 0.019418420270085335,
      "rmse_dx": 0.00630091642960906,
      "rmse_dy": 0.004300922155380249,
      "rmse_mean": 0.010006753727793694,
      "rotation_flip": 0.0045045046135783195,
      "sparse_tokens": 32025.0,
      "step": 6339,
      "turn_loss": 0.04154776409268379,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.29455491544322615,
      "grad_norm": 0.4469994902610779,
      "learning_rate": 4.631435453031047e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.012774464674293995,
      "mae_dx": 0.0017157656839117408,
      "mae_dy": 0.0027619183529168367,
      "pose_mae_dtheta": 0.08911751955747604,
      "pose_mae_dx": 0.026369089260697365,
      "pose_mae_dy": 0.033266931772232056,
      "pose_rmse_dtheta": 0.2268645316362381,
      "pose_rmse_dx": 0.05953981354832649,
      "pose_rmse_dy": 0.0734148845076561,
      "pose_rmse_mean": 0.11993974447250366,
      "rmse_dtheta": 0.02783232368528843,
      "rmse_dx": 0.004918110556900501,
      "rmse_dy": 0.0054179406724870205,
      "rmse_mean": 0.012722792103886604,
      "rotation_flip": 0.003537318669259548,
      "sparse_tokens": 32105.0,
      "step": 6340,
      "turn_loss": 0.08826909959316254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2946013752090689,
      "grad_norm": 0.5060915946960449,
      "learning_rate": 4.630116843896329e-06,
      "loss": 0.0873,
      "mae_dtheta": 0.010532778687775135,
      "mae_dx": 0.0023271478712558746,
      "mae_dy": 0.002627104055136442,
      "pose_mae_dtheta": 0.07249993830919266,
      "pose_mae_dx": 0.024891691282391548,
      "pose_mae_dy": 0.027528712525963783,
      "pose_rmse_dtheta": 0.18526454269886017,
      "pose_rmse_dx": 0.07081040740013123,
      "pose_rmse_dy": 0.06742224842309952,
      "pose_rmse_mean": 0.1078324019908905,
      "rmse_dtheta": 0.02433309704065323,
      "rmse_dx": 0.007897661067545414,
      "rmse_dy": 0.007077251095324755,
      "rmse_mean": 0.013102669268846512,
      "rotation_flip": 0.0039028620813041925,
      "sparse_tokens": 32089.0,
      "step": 6341,
      "turn_loss": 0.08570810407400131,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2946478349749117,
      "grad_norm": 0.4972659647464752,
      "learning_rate": 4.6287982606277375e-06,
      "loss": 0.0965,
      "mae_dtheta": 0.011342021636664867,
      "mae_dx": 0.002207710174843669,
      "mae_dy": 0.0025082428473979235,
      "pose_mae_dtheta": 0.07372408360242844,
      "pose_mae_dx": 0.022282332181930542,
      "pose_mae_dy": 0.028189266100525856,
      "pose_rmse_dtheta": 0.15773281455039978,
      "pose_rmse_dx": 0.05077044665813446,
      "pose_rmse_dy": 0.06066663935780525,
      "pose_rmse_mean": 0.08972330391407013,
      "rmse_dtheta": 0.02231624722480774,
      "rmse_dx": 0.007922264747321606,
      "rmse_dy": 0.005535965785384178,
      "rmse_mean": 0.011924825608730316,
      "rotation_flip": 0.00939849577844143,
      "sparse_tokens": 32105.0,
      "step": 6342,
      "turn_loss": 0.10514245927333832,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.2946942947407545,
      "grad_norm": 0.6875625252723694,
      "learning_rate": 4.627479703317485e-06,
      "loss": 0.1759,
      "mae_dtheta": 0.051326896995306015,
      "mae_dx": 0.017588891088962555,
      "mae_dy": 0.0057089803740382195,
      "pose_mae_dtheta": 0.4700489044189453,
      "pose_mae_dx": 0.13843874633312225,
      "pose_mae_dy": 0.06475424021482468,
      "pose_rmse_dtheta": 0.7177927494049072,
      "pose_rmse_dx": 0.26674798130989075,
      "pose_rmse_dy": 0.16895119845867157,
      "pose_rmse_mean": 0.3844972848892212,
      "rmse_dtheta": 0.07250857353210449,
      "rmse_dx": 0.0302325040102005,
      "rmse_dy": 0.012441660277545452,
      "rmse_mean": 0.038394246250391006,
      "rotation_flip": 0.01244813296943903,
      "sparse_tokens": 7444.0,
      "step": 6343,
      "turn_loss": 0.33862245082855225,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2947407545065973,
      "grad_norm": 0.6392384171485901,
      "learning_rate": 4.6261611720577745e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.01548844762146473,
      "mae_dx": 0.0021152745466679335,
      "mae_dy": 0.003186752088367939,
      "pose_mae_dtheta": 0.11308535933494568,
      "pose_mae_dx": 0.02619026228785515,
      "pose_mae_dy": 0.03383554890751839,
      "pose_rmse_dtheta": 0.27072039246559143,
      "pose_rmse_dx": 0.06337440758943558,
      "pose_rmse_dy": 0.07553218305110931,
      "pose_rmse_mean": 0.13654232025146484,
      "rmse_dtheta": 0.03146376833319664,
      "rmse_dx": 0.006515918765217066,
      "rmse_dy": 0.007476328872144222,
      "rmse_mean": 0.015152006410062313,
      "rotation_flip": 0.007933645509183407,
      "sparse_tokens": 32089.0,
      "step": 6344,
      "turn_loss": 0.12191000580787659,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2947872142724401,
      "grad_norm": 0.6892023682594299,
      "learning_rate": 4.624842666940817e-06,
      "loss": 0.1887,
      "mae_dtheta": 0.0109635004773736,
      "mae_dx": 0.003861029166728258,
      "mae_dy": 0.001736556296236813,
      "pose_mae_dtheta": 0.08216945827007294,
      "pose_mae_dx": 0.03648890182375908,
      "pose_mae_dy": 0.026918044313788414,
      "pose_rmse_dtheta": 0.2063455730676651,
      "pose_rmse_dx": 0.11617260426282883,
      "pose_rmse_dy": 0.07449828088283539,
      "pose_rmse_mean": 0.13233882188796997,
      "rmse_dtheta": 0.02586301416158676,
      "rmse_dx": 0.012387399561703205,
      "rmse_dy": 0.003881921526044607,
      "rmse_mean": 0.014044111594557762,
      "rotation_flip": 0.001377410488203168,
      "sparse_tokens": 32121.0,
      "step": 6345,
      "turn_loss": 0.10228374600410461,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.29483367403828287,
      "grad_norm": 0.46462640166282654,
      "learning_rate": 4.62352418805881e-06,
      "loss": 0.1093,
      "mae_dtheta": 0.03509713336825371,
      "mae_dx": 0.011737273074686527,
      "mae_dy": 0.0029302018228918314,
      "pose_mae_dtheta": 0.28290823101997375,
      "pose_mae_dx": 0.08632200956344604,
      "pose_mae_dy": 0.03721217066049576,
      "pose_rmse_dtheta": 0.5025711059570312,
      "pose_rmse_dx": 0.2059520035982132,
      "pose_rmse_dy": 0.0873885452747345,
      "pose_rmse_mean": 0.26530390977859497,
      "rmse_dtheta": 0.054001230746507645,
      "rmse_dx": 0.024043560028076172,
      "rmse_dy": 0.006361003499478102,
      "rmse_mean": 0.028135262429714203,
      "rotation_flip": 0.014652014710009098,
      "sparse_tokens": 9377.0,
      "step": 6346,
      "turn_loss": 0.20947518944740295,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 35038.0,
      "epoch": 0.29488013380412564,
      "grad_norm": 1.0989493131637573,
      "learning_rate": 4.6222057355039614e-06,
      "loss": 0.2749,
      "mae_dtheta": 0.036222878843545914,
      "mae_dx": 0.014034189283847809,
      "mae_dy": 0.004753935616463423,
      "pose_mae_dtheta": 0.28796228766441345,
      "pose_mae_dx": 0.11884861439466476,
      "pose_mae_dy": 0.05197988823056221,
      "pose_rmse_dtheta": 0.5178868770599365,
      "pose_rmse_dx": 0.2424481064081192,
      "pose_rmse_dy": 0.15984441339969635,
      "pose_rmse_mean": 0.30672645568847656,
      "rmse_dtheta": 0.056373678147792816,
      "rmse_dx": 0.026933765038847923,
      "rmse_dy": 0.012891589663922787,
      "rmse_mean": 0.03206634521484375,
      "rotation_flip": 0.01130653265863657,
      "sparse_tokens": 25918.0,
      "step": 6347,
      "turn_loss": 0.27170437574386597,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.2949265935699684,
      "grad_norm": 0.5537729263305664,
      "learning_rate": 4.620887309368466e-06,
      "loss": 0.1388,
      "mae_dtheta": 0.03766196593642235,
      "mae_dx": 0.009517482481896877,
      "mae_dy": 0.007315901108086109,
      "pose_mae_dtheta": 0.29197871685028076,
      "pose_mae_dx": 0.05910421162843704,
      "pose_mae_dy": 0.06600184738636017,
      "pose_rmse_dtheta": 0.5050124526023865,
      "pose_rmse_dx": 0.1362846940755844,
      "pose_rmse_dy": 0.16741225123405457,
      "pose_rmse_mean": 0.2695698142051697,
      "rmse_dtheta": 0.056379787623882294,
      "rmse_dx": 0.01990962214767933,
      "rmse_dy": 0.015550986863672733,
      "rmse_mean": 0.03061346523463726,
      "rotation_flip": 0.013539651408791542,
      "sparse_tokens": 16003.0,
      "step": 6348,
      "turn_loss": 0.324166864156723,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2949730533358112,
      "grad_norm": 0.561058521270752,
      "learning_rate": 4.619568909744524e-06,
      "loss": 0.1226,
      "mae_dtheta": 0.011205395683646202,
      "mae_dx": 0.0016666610026732087,
      "mae_dy": 0.002413579262793064,
      "pose_mae_dtheta": 0.0790158063173294,
      "pose_mae_dx": 0.02230983041226864,
      "pose_mae_dy": 0.03157931938767433,
      "pose_rmse_dtheta": 0.2153407782316208,
      "pose_rmse_dx": 0.060804035514593124,
      "pose_rmse_dy": 0.0954236388206482,
      "pose_rmse_mean": 0.12385614961385727,
      "rmse_dtheta": 0.02401074394583702,
      "rmse_dx": 0.005726411938667297,
      "rmse_dy": 0.005558984819799662,
      "rmse_mean": 0.011765381321310997,
      "rotation_flip": 0.009409751743078232,
      "sparse_tokens": 32041.0,
      "step": 6349,
      "turn_loss": 0.08026853948831558,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.295019513101654,
      "grad_norm": 0.5127758383750916,
      "learning_rate": 4.618250536724336e-06,
      "loss": 0.086,
      "mae_dtheta": 0.006780556403100491,
      "mae_dx": 0.0016482105711475015,
      "mae_dy": 0.001029427396133542,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5127758383750916,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.260986328125,
      "model/head/act_norm_mean": 122.91898476957071,
      "model/head/act_norm_min": 62.203590393066406,
      "model/head/act_over_embed": 84.47107711931532,
      "model/head/grad_frac": 0.07407257705926895,
      "model/head/grad_norm": 0.037982627749443054,
      "model/head/grad_zero_frac": 0.00018401762645225972,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6918994633838383,
      "model/head/update_ratio": 0.0006485128542408347,
      "model/head/weight_delta": 9.10941219329834,
      "model/head/weight_delta_rel": 0.15980607271194458,
      "model/head/weight_norm": 58.56881332397461,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4210999011993408,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42103847069076344,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42096152901649475,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2893415788829597,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09280382841825485,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0475875623524189,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5525695543248945,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001537795178592205,
      "model/modality_embedder.encoders.pose/weight_delta": 2.940859794616699,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09608705341815948,
      "model/modality_embedder.encoders.pose/weight_norm": 30.94532012939453,
      "model/modality_embedder/grad_frac": 0.09280382841825485,
      "model/modality_embedder/grad_norm": 0.0475875623524189,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5525695543248945,
      "model/modality_embedder/update_ratio": 0.001537795178592205,
      "model/modality_embedder/weight_delta": 2.940859794616699,
      "model/modality_embedder/weight_delta_rel": 0.09608705341815948,
      "model/modality_embedder/weight_norm": 30.94532012939453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.26660919189453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.904210758377424,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.105162620544434,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.114406790051532,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05564428120851517,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02853304333984852,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010235952213406563,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3472719192504883,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08553600311279297,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.87531852722168,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.11518096923828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.990863496071828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.43124008178711,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.861164724798343,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.060932330787181854,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03124462626874447,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010545309633016586,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.974961042404175,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10305497795343399,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.628931045532227,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.26081085205078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.827290764790764,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.209444999694824,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.123174736764962,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06928762793540955,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03552902117371559,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011614266550168395,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.2087173461914062,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10774271935224533,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.590843200683594,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.78772735595703,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.526126843835176,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.106449127197266,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.29063079503824,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08547847718000412,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.043831296265125275,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014688323717564344,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7427613735198975,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09373456984758377,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.840911865234375,
      "model/normalizer/grad_frac": 0.32364681363105774,
      "model/normalizer/grad_norm": 0.16595827043056488,
      "model/normalizer/grad_zero_frac": 0.00018671466386877,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021141457837074995,
      "model/normalizer/weight_delta": 5.804702281951904,
      "model/normalizer/weight_delta_rel": 0.07476120442152023,
      "model/normalizer/weight_norm": 78.49897003173828,
      "pose_mae_dtheta": 0.045970331877470016,
      "pose_mae_dx": 0.014227909035980701,
      "pose_mae_dy": 0.013202942907810211,
      "pose_rmse_dtheta": 0.1250012367963791,
      "pose_rmse_dx": 0.032449088990688324,
      "pose_rmse_dy": 0.02930399589240551,
      "pose_rmse_mean": 0.062251441180706024,
      "rmse_dtheta": 0.018421385437250137,
      "rmse_dx": 0.004780742339789867,
      "rmse_dy": 0.0021349103190004826,
      "rmse_mean": 0.008445680141448975,
      "rotation_flip": 0.0015673980815336108,
      "sparse_tokens": 32217.0,
      "step": 6350,
      "turn_loss": 0.04908004030585289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.29506597286749675,
      "grad_norm": 0.44377240538597107,
      "learning_rate": 4.616932190400089e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.00874947290867567,
      "mae_dx": 0.0014928763266652822,
      "mae_dy": 0.0017205585027113557,
      "pose_mae_dtheta": 0.062265343964099884,
      "pose_mae_dx": 0.017138933762907982,
      "pose_mae_dy": 0.0224801916629076,
      "pose_rmse_dtheta": 0.18328797817230225,
      "pose_rmse_dx": 0.04668422043323517,
      "pose_rmse_dy": 0.04791334271430969,
      "pose_rmse_mean": 0.09262852370738983,
      "rmse_dtheta": 0.02040577121078968,
      "rmse_dx": 0.005142415873706341,
      "rmse_dy": 0.0035146677400916815,
      "rmse_mean": 0.009687618352472782,
      "rotation_flip": 0.004355400800704956,
      "sparse_tokens": 32105.0,
      "step": 6351,
      "turn_loss": 0.0735093504190445,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.2951124326333395,
      "grad_norm": 0.6220255494117737,
      "learning_rate": 4.615613870863982e-06,
      "loss": 0.1491,
      "mae_dtheta": 0.03729896619915962,
      "mae_dx": 0.011574549600481987,
      "mae_dy": 0.00861621368676424,
      "pose_mae_dtheta": 0.2898828387260437,
      "pose_mae_dx": 0.1083686351776123,
      "pose_mae_dy": 0.08449084311723709,
      "pose_rmse_dtheta": 0.5095233917236328,
      "pose_rmse_dx": 0.23997370898723602,
      "pose_rmse_dy": 0.169786736369133,
      "pose_rmse_mean": 0.3064279556274414,
      "rmse_dtheta": 0.05736369267106056,
      "rmse_dx": 0.023178789764642715,
      "rmse_dy": 0.014668000862002373,
      "rmse_mean": 0.0317368283867836,
      "rotation_flip": 0.03055555559694767,
      "sparse_tokens": 6666.0,
      "step": 6352,
      "turn_loss": 0.30775150656700134,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 9408.0,
      "epoch": 0.2951588923991823,
      "grad_norm": 0.7698957324028015,
      "learning_rate": 4.614295578208202e-06,
      "loss": 0.1441,
      "mae_dtheta": 0.03457195684313774,
      "mae_dx": 0.01052010990679264,
      "mae_dy": 0.00656856270506978,
      "pose_mae_dtheta": 0.25906968116760254,
      "pose_mae_dx": 0.07314977049827576,
      "pose_mae_dy": 0.05513310432434082,
      "pose_rmse_dtheta": 0.5059958100318909,
      "pose_rmse_dx": 0.15053418278694153,
      "pose_rmse_dy": 0.1409880369901657,
      "pose_rmse_mean": 0.2658393681049347,
      "rmse_dtheta": 0.058094337582588196,
      "rmse_dx": 0.020021140575408936,
      "rmse_dy": 0.013687036000192165,
      "rmse_mean": 0.030600838363170624,
      "rotation_flip": 0.014598540030419827,
      "sparse_tokens": 7824.0,
      "step": 6353,
      "turn_loss": 0.3570379316806793,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.2952053521650251,
      "grad_norm": 0.6193329691886902,
      "learning_rate": 4.6129773125249415e-06,
      "loss": 0.1761,
      "mae_dtheta": 0.03176318109035492,
      "mae_dx": 0.013826960697770119,
      "mae_dy": 0.00802280567586422,
      "pose_mae_dtheta": 0.23853391408920288,
      "pose_mae_dx": 0.10703922808170319,
      "pose_mae_dy": 0.10614689439535141,
      "pose_rmse_dtheta": 0.37159523367881775,
      "pose_rmse_dx": 0.24262280762195587,
      "pose_rmse_dy": 0.21990472078323364,
      "pose_rmse_mean": 0.27804094552993774,
      "rmse_dtheta": 0.044887419790029526,
      "rmse_dx": 0.027242019772529602,
      "rmse_dy": 0.016098057851195335,
      "rmse_mean": 0.029409168288111687,
      "rotation_flip": 0.010273972526192665,
      "sparse_tokens": 10640.0,
      "step": 6354,
      "turn_loss": 0.32998090982437134,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 19421.0,
      "epoch": 0.29525181193086786,
      "grad_norm": 0.4362184703350067,
      "learning_rate": 4.611659073906382e-06,
      "loss": 0.099,
      "mae_dtheta": 0.027777081355452538,
      "mae_dx": 0.006991158239543438,
      "mae_dy": 0.0042108395136892796,
      "pose_mae_dtheta": 0.22582045197486877,
      "pose_mae_dx": 0.0623307041823864,
      "pose_mae_dy": 0.06142802536487579,
      "pose_rmse_dtheta": 0.388009250164032,
      "pose_rmse_dx": 0.14801204204559326,
      "pose_rmse_dy": 0.1237601488828659,
      "pose_rmse_mean": 0.21992716193199158,
      "rmse_dtheta": 0.04476236179471016,
      "rmse_dx": 0.017001507803797722,
      "rmse_dy": 0.00853720773011446,
      "rmse_mean": 0.023433692753314972,
      "rotation_flip": 0.010943912900984287,
      "sparse_tokens": 15856.0,
      "step": 6355,
      "turn_loss": 0.1528814435005188,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 27494.0,
      "epoch": 0.29529827169671063,
      "grad_norm": 1.1201820373535156,
      "learning_rate": 4.610340862444713e-06,
      "loss": 0.2958,
      "mae_dtheta": 0.039560914039611816,
      "mae_dx": 0.01491483673453331,
      "mae_dy": 0.006753535475581884,
      "pose_mae_dtheta": 0.3240129053592682,
      "pose_mae_dx": 0.1199689581990242,
      "pose_mae_dy": 0.09043223410844803,
      "pose_rmse_dtheta": 0.5481632947921753,
      "pose_rmse_dx": 0.2557246685028076,
      "pose_rmse_dy": 0.2052164226770401,
      "pose_rmse_mean": 0.3363681435585022,
      "rmse_dtheta": 0.057234298437833786,
      "rmse_dx": 0.027737846598029137,
      "rmse_dy": 0.013398252427577972,
      "rmse_mean": 0.032790131866931915,
      "rotation_flip": 0.01256281416863203,
      "sparse_tokens": 22004.0,
      "step": 6356,
      "turn_loss": 0.3359391391277313,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.2953447314625534,
      "grad_norm": 0.7149373888969421,
      "learning_rate": 4.609022678232118e-06,
      "loss": 0.147,
      "mae_dtheta": 0.03193509951233864,
      "mae_dx": 0.013904917985200882,
      "mae_dy": 0.007673338055610657,
      "pose_mae_dtheta": 0.24557200074195862,
      "pose_mae_dx": 0.08101815730333328,
      "pose_mae_dy": 0.11332768946886063,
      "pose_rmse_dtheta": 0.41806674003601074,
      "pose_rmse_dx": 0.162908673286438,
      "pose_rmse_dy": 0.2491820603609085,
      "pose_rmse_mean": 0.2767191529273987,
      "rmse_dtheta": 0.04841051250696182,
      "rmse_dx": 0.025800146162509918,
      "rmse_dy": 0.013905717991292477,
      "rmse_mean": 0.02937212586402893,
      "rotation_flip": 0.018518518656492233,
      "sparse_tokens": 7675.0,
      "step": 6357,
      "turn_loss": 0.3214368522167206,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.2953911912283962,
      "grad_norm": 0.6251820921897888,
      "learning_rate": 4.6077045213607765e-06,
      "loss": 0.1383,
      "mae_dtheta": 0.0347038172185421,
      "mae_dx": 0.011506832204759121,
      "mae_dy": 0.006969145964831114,
      "pose_mae_dtheta": 0.23977310955524445,
      "pose_mae_dx": 0.08897988498210907,
      "pose_mae_dy": 0.09723402559757233,
      "pose_rmse_dtheta": 0.45178505778312683,
      "pose_rmse_dx": 0.20354856550693512,
      "pose_rmse_dy": 0.19672633707523346,
      "pose_rmse_mean": 0.28402000665664673,
      "rmse_dtheta": 0.05330710485577583,
      "rmse_dx": 0.024656031280755997,
      "rmse_dy": 0.011868364177644253,
      "rmse_mean": 0.029943834990262985,
      "rotation_flip": 0.019313305616378784,
      "sparse_tokens": 8428.0,
      "step": 6358,
      "turn_loss": 0.24394342303276062,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.29543765099423897,
      "grad_norm": 0.46917667984962463,
      "learning_rate": 4.606386391922868e-06,
      "loss": 0.0837,
      "mae_dtheta": 0.012648544274270535,
      "mae_dx": 0.002947764005511999,
      "mae_dy": 0.0032730894163250923,
      "pose_mae_dtheta": 0.08984363079071045,
      "pose_mae_dx": 0.03319830074906349,
      "pose_mae_dy": 0.03498421236872673,
      "pose_rmse_dtheta": 0.20350155234336853,
      "pose_rmse_dx": 0.08967345952987671,
      "pose_rmse_dy": 0.08225508779287338,
      "pose_rmse_mean": 0.1251433789730072,
      "rmse_dtheta": 0.02570379339158535,
      "rmse_dx": 0.008580472320318222,
      "rmse_dy": 0.00762608228251338,
      "rmse_mean": 0.013970116153359413,
      "rotation_flip": 0.007603186182677746,
      "sparse_tokens": 32121.0,
      "step": 6359,
      "turn_loss": 0.11128439754247665,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.29548411076008174,
      "grad_norm": 0.6808795928955078,
      "learning_rate": 4.605068290010569e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.005283014848828316,
      "mae_dx": 0.0010894350707530975,
      "mae_dy": 0.000716355920303613,
      "pose_mae_dtheta": 0.03867768868803978,
      "pose_mae_dx": 0.010076967999339104,
      "pose_mae_dy": 0.009751883335411549,
      "pose_rmse_dtheta": 0.1720629781484604,
      "pose_rmse_dx": 0.027383485808968544,
      "pose_rmse_dy": 0.030391329899430275,
      "pose_rmse_mean": 0.07661260664463043,
      "rmse_dtheta": 0.02020340971648693,
      "rmse_dx": 0.003762517822906375,
      "rmse_dy": 0.0020802991930395365,
      "rmse_mean": 0.008682075887918472,
      "rotation_flip": 0.00524658989161253,
      "sparse_tokens": 32057.0,
      "step": 6360,
      "turn_loss": 0.03929690271615982,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.2955305705259246,
      "grad_norm": 0.5276842713356018,
      "learning_rate": 4.603750215716057e-06,
      "loss": 0.1455,
      "mae_dtheta": 0.037746988236904144,
      "mae_dx": 0.007671362720429897,
      "mae_dy": 0.004347371403127909,
      "pose_mae_dtheta": 0.2810575067996979,
      "pose_mae_dx": 0.06728251278400421,
      "pose_mae_dy": 0.04721095785498619,
      "pose_rmse_dtheta": 0.4693928360939026,
      "pose_rmse_dx": 0.15774941444396973,
      "pose_rmse_dy": 0.0997200682759285,
      "pose_rmse_mean": 0.24228744208812714,
      "rmse_dtheta": 0.05547713860869408,
      "rmse_dx": 0.018243053928017616,
      "rmse_dy": 0.009062173776328564,
      "rmse_mean": 0.027594123035669327,
      "rotation_flip": 0.01952277682721615,
      "sparse_tokens": 8545.0,
      "step": 6361,
      "turn_loss": 0.29877910017967224,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.29557703029176735,
      "grad_norm": 0.6180928945541382,
      "learning_rate": 4.602432169131508e-06,
      "loss": 0.1855,
      "mae_dtheta": 0.02744627743959427,
      "mae_dx": 0.006775363814085722,
      "mae_dy": 0.0030007301829755306,
      "pose_mae_dtheta": 0.22813990712165833,
      "pose_mae_dx": 0.05193362385034561,
      "pose_mae_dy": 0.027851486578583717,
      "pose_rmse_dtheta": 0.4697377681732178,
      "pose_rmse_dx": 0.12335026264190674,
      "pose_rmse_dy": 0.07568889111280441,
      "pose_rmse_mean": 0.22292564809322357,
      "rmse_dtheta": 0.04889952391386032,
      "rmse_dx": 0.016240999102592468,
      "rmse_dy": 0.006164864636957645,
      "rmse_mean": 0.023768462240695953,
      "rotation_flip": 0.012773722410202026,
      "sparse_tokens": 9123.0,
      "step": 6362,
      "turn_loss": 0.15943461656570435,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.2956234900576101,
      "grad_norm": 0.5466645956039429,
      "learning_rate": 4.6011141503490874e-06,
      "loss": 0.0951,
      "mae_dtheta": 0.008976220153272152,
      "mae_dx": 0.0019148477585986257,
      "mae_dy": 0.0019126993138343096,
      "pose_mae_dtheta": 0.06319168955087662,
      "pose_mae_dx": 0.021881403401494026,
      "pose_mae_dy": 0.018310852348804474,
      "pose_rmse_dtheta": 0.18871507048606873,
      "pose_rmse_dx": 0.05437310412526131,
      "pose_rmse_dy": 0.04343732073903084,
      "pose_rmse_mean": 0.09550850093364716,
      "rmse_dtheta": 0.023558234795928,
      "rmse_dx": 0.004949300549924374,
      "rmse_dy": 0.0045418571680784225,
      "rmse_mean": 0.011016463860869408,
      "rotation_flip": 0.0043196543119847775,
      "sparse_tokens": 32201.0,
      "step": 6363,
      "turn_loss": 0.06429780274629593,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2956699498234529,
      "grad_norm": 0.46765056252479553,
      "learning_rate": 4.599796159460971e-06,
      "loss": 0.0966,
      "mae_dtheta": 0.010317573323845863,
      "mae_dx": 0.0018274186877533793,
      "mae_dy": 0.0021969047375023365,
      "pose_mae_dtheta": 0.06624884903430939,
      "pose_mae_dx": 0.023875582963228226,
      "pose_mae_dy": 0.026743823662400246,
      "pose_rmse_dtheta": 0.13477610051631927,
      "pose_rmse_dx": 0.06380339711904526,
      "pose_rmse_dy": 0.05394788458943367,
      "pose_rmse_mean": 0.08417579531669617,
      "rmse_dtheta": 0.020045990124344826,
      "rmse_dx": 0.0067785754799842834,
      "rmse_dy": 0.005286266095936298,
      "rmse_mean": 0.010703611187636852,
      "rotation_flip": 0.0048652696423232555,
      "sparse_tokens": 32073.0,
      "step": 6364,
      "turn_loss": 0.0728047713637352,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.2957164095892957,
      "grad_norm": 0.827766478061676,
      "learning_rate": 4.5984781965593215e-06,
      "loss": 0.1469,
      "mae_dtheta": 0.04280263930559158,
      "mae_dx": 0.012565390206873417,
      "mae_dy": 0.006934395991265774,
      "pose_mae_dtheta": 0.3194478452205658,
      "pose_mae_dx": 0.0973629504442215,
      "pose_mae_dy": 0.08417732268571854,
      "pose_rmse_dtheta": 0.5150195360183716,
      "pose_rmse_dx": 0.2016710489988327,
      "pose_rmse_dy": 0.1665220409631729,
      "pose_rmse_mean": 0.29440420866012573,
      "rmse_dtheta": 0.059634581208229065,
      "rmse_dx": 0.02462279424071312,
      "rmse_dy": 0.012139667756855488,
      "rmse_mean": 0.0321323499083519,
      "rotation_flip": 0.012847965583205223,
      "sparse_tokens": 6872.0,
      "step": 6365,
      "turn_loss": 0.3115244209766388,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.29576286935513846,
      "grad_norm": 0.5610366463661194,
      "learning_rate": 4.597160261736309e-06,
      "loss": 0.1585,
      "mae_dtheta": 0.012299714609980583,
      "mae_dx": 0.003002671292051673,
      "mae_dy": 0.003355494700372219,
      "pose_mae_dtheta": 0.08681315183639526,
      "pose_mae_dx": 0.03267798572778702,
      "pose_mae_dy": 0.036412809044122696,
      "pose_rmse_dtheta": 0.19876667857170105,
      "pose_rmse_dx": 0.10129520297050476,
      "pose_rmse_dy": 0.08235228061676025,
      "pose_rmse_mean": 0.12747138738632202,
      "rmse_dtheta": 0.024781037122011185,
      "rmse_dx": 0.010040989145636559,
      "rmse_dy": 0.007608028594404459,
      "rmse_mean": 0.014143351465463638,
      "rotation_flip": 0.005481597501784563,
      "sparse_tokens": 32057.0,
      "step": 6366,
      "turn_loss": 0.13127003610134125,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31790.0,
      "epoch": 0.29580932912098123,
      "grad_norm": 0.3894183933734894,
      "learning_rate": 4.595842355084094e-06,
      "loss": 0.1394,
      "mae_dtheta": 0.03480405732989311,
      "mae_dx": 0.011387983337044716,
      "mae_dy": 0.004571945406496525,
      "pose_mae_dtheta": 0.29069527983665466,
      "pose_mae_dx": 0.09379251301288605,
      "pose_mae_dy": 0.04989107325673103,
      "pose_rmse_dtheta": 0.4920891523361206,
      "pose_rmse_dx": 0.19276063144207,
      "pose_rmse_dy": 0.1382567137479782,
      "pose_rmse_mean": 0.27436885237693787,
      "rmse_dtheta": 0.05283753573894501,
      "rmse_dx": 0.022231504321098328,
      "rmse_dy": 0.010254770517349243,
      "rmse_mean": 0.02844127081334591,
      "rotation_flip": 0.011111111380159855,
      "sparse_tokens": 24439.0,
      "step": 6367,
      "turn_loss": 0.2555493414402008,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 10408.0,
      "epoch": 0.295855788886824,
      "grad_norm": 0.8433917164802551,
      "learning_rate": 4.594524476694841e-06,
      "loss": 0.1867,
      "mae_dtheta": 0.035575222223997116,
      "mae_dx": 0.01592927984893322,
      "mae_dy": 0.008492408320307732,
      "pose_mae_dtheta": 0.3054406940937042,
      "pose_mae_dx": 0.14321641623973846,
      "pose_mae_dy": 0.10257405042648315,
      "pose_rmse_dtheta": 0.5293365120887756,
      "pose_rmse_dx": 0.3321639597415924,
      "pose_rmse_dy": 0.26249971985816956,
      "pose_rmse_mean": 0.3746667504310608,
      "rmse_dtheta": 0.052348487079143524,
      "rmse_dx": 0.03198856860399246,
      "rmse_dy": 0.018976788967847824,
      "rmse_mean": 0.03443795070052147,
      "rotation_flip": 0.023746700957417488,
      "sparse_tokens": 8202.0,
      "step": 6368,
      "turn_loss": 0.3519671559333801,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.2959022486526668,
      "grad_norm": 0.4003387689590454,
      "learning_rate": 4.59320662666071e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.008208833634853363,
      "mae_dx": 0.0018010485218837857,
      "mae_dy": 0.0018072021193802357,
      "pose_mae_dtheta": 0.05667528510093689,
      "pose_mae_dx": 0.01957671344280243,
      "pose_mae_dy": 0.020440980792045593,
      "pose_rmse_dtheta": 0.1442907303571701,
      "pose_rmse_dx": 0.05051877722144127,
      "pose_rmse_dy": 0.055574383586645126,
      "pose_rmse_mean": 0.08346129953861237,
      "rmse_dtheta": 0.019861409440636635,
      "rmse_dx": 0.005235343240201473,
      "rmse_dy": 0.0041928659193217754,
      "rmse_mean": 0.009763206355273724,
      "rotation_flip": 0.00267686415463686,
      "sparse_tokens": 32169.0,
      "step": 6369,
      "turn_loss": 0.07183463871479034,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.29594870841850957,
      "grad_norm": 0.5272713303565979,
      "learning_rate": 4.591888805073855e-06,
      "loss": 0.1069,
      "mae_dtheta": 0.02198108285665512,
      "mae_dx": 0.006054704077541828,
      "mae_dy": 0.0037956959567964077,
      "pose_mae_dtheta": 0.1842721849679947,
      "pose_mae_dx": 0.0383748896420002,
      "pose_mae_dy": 0.05500996485352516,
      "pose_rmse_dtheta": 0.34362199902534485,
      "pose_rmse_dx": 0.10767558962106705,
      "pose_rmse_dy": 0.13018406927585602,
      "pose_rmse_mean": 0.19382721185684204,
      "rmse_dtheta": 0.03760606050491333,
      "rmse_dx": 0.017334723845124245,
      "rmse_dy": 0.008377347141504288,
      "rmse_mean": 0.021106045693159103,
      "rotation_flip": 0.010893246158957481,
      "sparse_tokens": 12054.0,
      "step": 6370,
      "turn_loss": 0.16303864121437073,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.29599516818435234,
      "grad_norm": 0.4466317594051361,
      "learning_rate": 4.5905710120264385e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.0075216093100607395,
      "mae_dx": 0.0013918525073677301,
      "mae_dy": 0.001290543470531702,
      "pose_mae_dtheta": 0.04710322245955467,
      "pose_mae_dx": 0.016573941335082054,
      "pose_mae_dy": 0.01766830123960972,
      "pose_rmse_dtheta": 0.12758243083953857,
      "pose_rmse_dx": 0.04056186228990555,
      "pose_rmse_dy": 0.04773261398077011,
      "pose_rmse_mean": 0.07195897400379181,
      "rmse_dtheta": 0.019966930150985718,
      "rmse_dx": 0.003866535844281316,
      "rmse_dy": 0.003021172247827053,
      "rmse_mean": 0.008951546624302864,
      "rotation_flip": 0.008924144320189953,
      "sparse_tokens": 32121.0,
      "step": 6371,
      "turn_loss": 0.06474718451499939,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.2960416279501951,
      "grad_norm": 0.9724653959274292,
      "learning_rate": 4.589253247610608e-06,
      "loss": 0.1532,
      "mae_dtheta": 0.035250455141067505,
      "mae_dx": 0.01118631474673748,
      "mae_dy": 0.004184230696409941,
      "pose_mae_dtheta": 0.30026593804359436,
      "pose_mae_dx": 0.07690732926130295,
      "pose_mae_dy": 0.05540967360138893,
      "pose_rmse_dtheta": 0.5573673248291016,
      "pose_rmse_dx": 0.175123393535614,
      "pose_rmse_dy": 0.12335168570280075,
      "pose_rmse_mean": 0.28528082370758057,
      "rmse_dtheta": 0.05529983714222908,
      "rmse_dx": 0.023554490879178047,
      "rmse_dy": 0.007435295265167952,
      "rmse_mean": 0.02876320853829384,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 10868.0,
      "step": 6372,
      "turn_loss": 0.22477921843528748,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2960880877160379,
      "grad_norm": 0.47709837555885315,
      "learning_rate": 4.587935511918521e-06,
      "loss": 0.0872,
      "mae_dtheta": 0.0059678684920072556,
      "mae_dx": 0.0012062835739925504,
      "mae_dy": 0.0014969961484894156,
      "pose_mae_dtheta": 0.03675766661763191,
      "pose_mae_dx": 0.016047202050685883,
      "pose_mae_dy": 0.017842652276158333,
      "pose_rmse_dtheta": 0.08221804350614548,
      "pose_rmse_dx": 0.042399052530527115,
      "pose_rmse_dy": 0.046513255685567856,
      "pose_rmse_mean": 0.05704345554113388,
      "rmse_dtheta": 0.013655945658683777,
      "rmse_dx": 0.0038952601607888937,
      "rmse_dy": 0.0036107846535742283,
      "rmse_mean": 0.007053996901959181,
      "rotation_flip": 0.005922551266849041,
      "sparse_tokens": 32105.0,
      "step": 6373,
      "turn_loss": 0.0558476597070694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.29613454748188067,
      "grad_norm": 0.38579094409942627,
      "learning_rate": 4.586617805042322e-06,
      "loss": 0.0915,
      "mae_dtheta": 0.012128003872931004,
      "mae_dx": 0.0012431297218427062,
      "mae_dy": 0.00194340362213552,
      "pose_mae_dtheta": 0.07909723371267319,
      "pose_mae_dx": 0.018978405743837357,
      "pose_mae_dy": 0.026787538081407547,
      "pose_rmse_dtheta": 0.19800668954849243,
      "pose_rmse_dx": 0.04732273891568184,
      "pose_rmse_dy": 0.06673412024974823,
      "pose_rmse_mean": 0.10402118414640427,
      "rmse_dtheta": 0.025586217641830444,
      "rmse_dx": 0.0036093939561396837,
      "rmse_dy": 0.0040107122622430325,
      "rmse_mean": 0.011068775318562984,
      "rotation_flip": 0.005557930562645197,
      "sparse_tokens": 32073.0,
      "step": 6374,
      "turn_loss": 0.08383513242006302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.29618100724772345,
      "grad_norm": 0.9144113063812256,
      "learning_rate": 4.585300127074163e-06,
      "loss": 0.2703,
      "mae_dtheta": 0.0390985831618309,
      "mae_dx": 0.01499107200652361,
      "mae_dy": 0.01455697137862444,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9144113659858704,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.39620971679688,
      "model/head/act_norm_mean": 110.68096923828125,
      "model/head/act_norm_min": 74.58539581298828,
      "model/head/act_over_embed": 76.06099827210666,
      "model/head/grad_frac": 0.12558887898921967,
      "model/head/grad_norm": 0.11483990401029587,
      "model/head/grad_zero_frac": 0.00015895316028036177,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7208984375,
      "model/head/update_ratio": 0.0019606847781687975,
      "model/head/weight_delta": 9.121346473693848,
      "model/head/weight_delta_rel": 0.16001543402671814,
      "model/head/weight_norm": 58.57132339477539,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4210796058177948,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4210796058177948,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4210796058177948,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28936984732736876,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 1.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0,
      "model/modality_embedder.encoders.pose/weight_delta": 2.943713426589966,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09618028998374939,
      "model/modality_embedder.encoders.pose/weight_norm": 30.94589614868164,
      "model/modality_embedder/grad_frac": 0.0,
      "model/modality_embedder/grad_norm": 0.0,
      "model/modality_embedder/grad_zero_frac": 1.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0,
      "model/modality_embedder/weight_delta": 2.943713426589966,
      "model/modality_embedder/weight_delta_rel": 0.09618028998374939,
      "model/modality_embedder/weight_norm": 30.94589614868164,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.79083251953125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.74347408234127,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.291254043579102,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.316737679291514,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10305824875831604,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.09423763304948807,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.003380607580766082,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3516905307769775,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08569702506065369,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.875946044921875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 80.07649230957031,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.526765562996033,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 13.007339477539062,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.855022918087847,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.11085150390863419,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.10136387497186661,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0034209173172712326,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.981292486190796,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10327430069446564,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.630613327026367,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.49381256103516,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.14280753968254,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.77747631072998,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.96558209409017,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09931915253400803,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.09081856161355972,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0029686728958040476,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.215430736541748,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10796814411878586,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.592309951782227,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.90522766113281,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.186390128968252,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 14.41394329071045,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.369951181768947,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0950072780251503,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08687573671340942,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002911183051764965,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7487540245056152,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09393937140703201,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.842073440551758,
      "model/normalizer/grad_frac": 0.4153051972389221,
      "model/normalizer/grad_norm": 0.3797597885131836,
      "model/normalizer/grad_zero_frac": 0.00021034943347331136,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00483767269179225,
      "model/normalizer/weight_delta": 5.816874027252197,
      "model/normalizer/weight_delta_rel": 0.07491797208786011,
      "model/normalizer/weight_norm": 78.5005111694336,
      "pose_mae_dtheta": 0.36342906951904297,
      "pose_mae_dx": 0.18285825848579407,
      "pose_mae_dy": 0.1613469421863556,
      "pose_rmse_dtheta": 0.5318878293037415,
      "pose_rmse_dx": 0.36954227089881897,
      "pose_rmse_dy": 0.26515066623687744,
      "pose_rmse_mean": 0.388860285282135,
      "rmse_dtheta": 0.05196031555533409,
      "rmse_dx": 0.030273165553808212,
      "rmse_dy": 0.01986526884138584,
      "rmse_mean": 0.0340329185128212,
      "rotation_flip": 0.0,
      "sparse_tokens": 2685.0,
      "step": 6375,
      "turn_loss": 0.3630010485649109,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2962274670135662,
      "grad_norm": 0.49770158529281616,
      "learning_rate": 4.583982478106189e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.010444761253893375,
      "mae_dx": 0.0015270402655005455,
      "mae_dy": 0.002113095484673977,
      "pose_mae_dtheta": 0.06621326506137848,
      "pose_mae_dx": 0.022345731034874916,
      "pose_mae_dy": 0.026012884452939034,
      "pose_rmse_dtheta": 0.17942671477794647,
      "pose_rmse_dx": 0.05500757321715355,
      "pose_rmse_dy": 0.05794306471943855,
      "pose_rmse_mean": 0.09745912253856659,
      "rmse_dtheta": 0.02348785288631916,
      "rmse_dx": 0.004294907674193382,
      "rmse_dy": 0.0044428762048482895,
      "rmse_mean": 0.010741880163550377,
      "rotation_flip": 0.0041050901636481285,
      "sparse_tokens": 32105.0,
      "step": 6376,
      "turn_loss": 0.08109455555677414,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.29627392677940906,
      "grad_norm": 0.7285188436508179,
      "learning_rate": 4.582664858230544e-06,
      "loss": 0.1359,
      "mae_dtheta": 0.041716255247592926,
      "mae_dx": 0.007912414148449898,
      "mae_dy": 0.004452822729945183,
      "pose_mae_dtheta": 0.32308119535446167,
      "pose_mae_dx": 0.06984972208738327,
      "pose_mae_dy": 0.11485233157873154,
      "pose_rmse_dtheta": 0.5315521359443665,
      "pose_rmse_dx": 0.20129215717315674,
      "pose_rmse_dy": 0.29183775186538696,
      "pose_rmse_mean": 0.3415606915950775,
      "rmse_dtheta": 0.06015228480100632,
      "rmse_dx": 0.01978580467402935,
      "rmse_dy": 0.009631914086639881,
      "rmse_mean": 0.029856670647859573,
      "rotation_flip": 0.0044052861630916595,
      "sparse_tokens": 4475.0,
      "step": 6377,
      "turn_loss": 0.28077536821365356,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.29632038654525183,
      "grad_norm": 0.5988916754722595,
      "learning_rate": 4.581347267539369e-06,
      "loss": 0.1267,
      "mae_dtheta": 0.016995375975966454,
      "mae_dx": 0.003991089295595884,
      "mae_dy": 0.0026630726642906666,
      "pose_mae_dtheta": 0.12559174001216888,
      "pose_mae_dx": 0.032911788672208786,
      "pose_mae_dy": 0.04199367016553879,
      "pose_rmse_dtheta": 0.31165045499801636,
      "pose_rmse_dx": 0.09540772438049316,
      "pose_rmse_dy": 0.0742257833480835,
      "pose_rmse_mean": 0.160427987575531,
      "rmse_dtheta": 0.034981269389390945,
      "rmse_dx": 0.013378371484577656,
      "rmse_dy": 0.004790300503373146,
      "rmse_mean": 0.017716646194458008,
      "rotation_flip": 0.008547008968889713,
      "sparse_tokens": 4337.0,
      "step": 6378,
      "turn_loss": 0.16911111772060394,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2963668463110946,
      "grad_norm": 0.7409853935241699,
      "learning_rate": 4.580029706124804e-06,
      "loss": 0.1439,
      "mae_dtheta": 0.013179210014641285,
      "mae_dx": 0.0044955043122172356,
      "mae_dy": 0.0038406618405133486,
      "pose_mae_dtheta": 0.09570077806711197,
      "pose_mae_dx": 0.04508890211582184,
      "pose_mae_dy": 0.040938667953014374,
      "pose_rmse_dtheta": 0.21110157668590546,
      "pose_rmse_dx": 0.11984342336654663,
      "pose_rmse_dy": 0.09357361495494843,
      "pose_rmse_mean": 0.14150622487068176,
      "rmse_dtheta": 0.02638614922761917,
      "rmse_dx": 0.012983584776520729,
      "rmse_dy": 0.009459121152758598,
      "rmse_mean": 0.0162762850522995,
      "rotation_flip": 0.008333333767950535,
      "sparse_tokens": 32041.0,
      "step": 6379,
      "turn_loss": 0.16636382043361664,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35688.0,
      "epoch": 0.2964133060769374,
      "grad_norm": 0.5834012627601624,
      "learning_rate": 4.578712174078986e-06,
      "loss": 0.163,
      "mae_dtheta": 0.041379544883966446,
      "mae_dx": 0.013657898642122746,
      "mae_dy": 0.005406131036579609,
      "pose_mae_dtheta": 0.33161935210227966,
      "pose_mae_dx": 0.10826367884874344,
      "pose_mae_dy": 0.06293979287147522,
      "pose_rmse_dtheta": 0.5522764325141907,
      "pose_rmse_dx": 0.2522682249546051,
      "pose_rmse_dy": 0.1611884981393814,
      "pose_rmse_mean": 0.3219110667705536,
      "rmse_dtheta": 0.05999954789876938,
      "rmse_dx": 0.02701088786125183,
      "rmse_dy": 0.013010887429118156,
      "rmse_mean": 0.033340442925691605,
      "rotation_flip": 0.02067464590072632,
      "sparse_tokens": 25386.0,
      "step": 6380,
      "turn_loss": 0.32571181654930115,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.29645976584278017,
      "grad_norm": 0.45301538705825806,
      "learning_rate": 4.577394671494054e-06,
      "loss": 0.0868,
      "mae_dtheta": 0.008249963633716106,
      "mae_dx": 0.0011261460604146123,
      "mae_dy": 0.0020555334631353617,
      "pose_mae_dtheta": 0.04919783025979996,
      "pose_mae_dx": 0.015295344404876232,
      "pose_mae_dy": 0.02485569380223751,
      "pose_rmse_dtheta": 0.0982990637421608,
      "pose_rmse_dx": 0.03734384849667549,
      "pose_rmse_dy": 0.056503720581531525,
      "pose_rmse_mean": 0.0640488788485527,
      "rmse_dtheta": 0.01628643460571766,
      "rmse_dx": 0.0029801628552377224,
      "rmse_dy": 0.00413781451061368,
      "rmse_mean": 0.007801470812410116,
      "rotation_flip": 0.008692502975463867,
      "sparse_tokens": 32089.0,
      "step": 6381,
      "turn_loss": 0.07433532178401947,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.29650622560862294,
      "grad_norm": 0.5437166690826416,
      "learning_rate": 4.5760771984621376e-06,
      "loss": 0.0869,
      "mae_dtheta": 0.009360669180750847,
      "mae_dx": 0.0016376827843487263,
      "mae_dy": 0.002624188782647252,
      "pose_mae_dtheta": 0.06448729336261749,
      "pose_mae_dx": 0.02584492601454258,
      "pose_mae_dy": 0.029839688912034035,
      "pose_rmse_dtheta": 0.17439523339271545,
      "pose_rmse_dx": 0.06825703382492065,
      "pose_rmse_dy": 0.07729985564947128,
      "pose_rmse_mean": 0.106650710105896,
      "rmse_dtheta": 0.021585708484053612,
      "rmse_dx": 0.004860889632254839,
      "rmse_dy": 0.00638774735853076,
      "rmse_mean": 0.010944781824946404,
      "rotation_flip": 0.005219660699367523,
      "sparse_tokens": 32089.0,
      "step": 6382,
      "turn_loss": 0.08444296568632126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2965526853744657,
      "grad_norm": 0.6054624319076538,
      "learning_rate": 4.574759755075373e-06,
      "loss": 0.123,
      "mae_dtheta": 0.006922658067196608,
      "mae_dx": 0.0011354427551850677,
      "mae_dy": 0.0011552860960364342,
      "pose_mae_dtheta": 0.04904041811823845,
      "pose_mae_dx": 0.014575084671378136,
      "pose_mae_dy": 0.015084960497915745,
      "pose_rmse_dtheta": 0.1767684817314148,
      "pose_rmse_dx": 0.04200541973114014,
      "pose_rmse_dy": 0.04264732077717781,
      "pose_rmse_mean": 0.08714041113853455,
      "rmse_dtheta": 0.021406719461083412,
      "rmse_dx": 0.003669672878459096,
      "rmse_dy": 0.0028312334325164557,
      "rmse_mean": 0.009302542544901371,
      "rotation_flip": 0.006633499171584845,
      "sparse_tokens": 32105.0,
      "step": 6383,
      "turn_loss": 0.06191391870379448,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2965991451403085,
      "grad_norm": 0.5024110078811646,
      "learning_rate": 4.573442341425884e-06,
      "loss": 0.1131,
      "mae_dtheta": 0.00789158046245575,
      "mae_dx": 0.0015408019535243511,
      "mae_dy": 0.0019766849000006914,
      "pose_mae_dtheta": 0.05545564368367195,
      "pose_mae_dx": 0.016318121924996376,
      "pose_mae_dy": 0.023849280551075935,
      "pose_rmse_dtheta": 0.12906143069267273,
      "pose_rmse_dx": 0.04679000750184059,
      "pose_rmse_dy": 0.055429164320230484,
      "pose_rmse_mean": 0.07709353417158127,
      "rmse_dtheta": 0.018019499257206917,
      "rmse_dx": 0.006337390281260014,
      "rmse_dy": 0.005598397925496101,
      "rmse_mean": 0.009985096752643585,
      "rotation_flip": 0.005434782709926367,
      "sparse_tokens": 32105.0,
      "step": 6384,
      "turn_loss": 0.07058225572109222,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2966456049061513,
      "grad_norm": 0.4560621380805969,
      "learning_rate": 4.572124957605803e-06,
      "loss": 0.1134,
      "mae_dtheta": 0.007270515896379948,
      "mae_dx": 0.0021371503826230764,
      "mae_dy": 0.0016642749542370439,
      "pose_mae_dtheta": 0.049322765320539474,
      "pose_mae_dx": 0.02189795859158039,
      "pose_mae_dy": 0.017656706273555756,
      "pose_rmse_dtheta": 0.14923985302448273,
      "pose_rmse_dx": 0.056303370743989944,
      "pose_rmse_dy": 0.04066263139247894,
      "pose_rmse_mean": 0.08206862211227417,
      "rmse_dtheta": 0.01884624920785427,
      "rmse_dx": 0.006310132332146168,
      "rmse_dy": 0.0038605076260864735,
      "rmse_mean": 0.009672297164797783,
      "rotation_flip": 0.007984031923115253,
      "sparse_tokens": 32121.0,
      "step": 6385,
      "turn_loss": 0.07727974653244019,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.29669206467199405,
      "grad_norm": 0.5693142414093018,
      "learning_rate": 4.570807603707251e-06,
      "loss": 0.1536,
      "mae_dtheta": 0.019244346767663956,
      "mae_dx": 0.004920326638966799,
      "mae_dy": 0.0046216086484491825,
      "pose_mae_dtheta": 0.13647229969501495,
      "pose_mae_dx": 0.053220827132463455,
      "pose_mae_dy": 0.07088203728199005,
      "pose_rmse_dtheta": 0.2328556478023529,
      "pose_rmse_dx": 0.13632738590240479,
      "pose_rmse_dy": 0.12633968889713287,
      "pose_rmse_mean": 0.16517424583435059,
      "rmse_dtheta": 0.02975195087492466,
      "rmse_dx": 0.014639275148510933,
      "rmse_dy": 0.007586800958961248,
      "rmse_mean": 0.017326008528470993,
      "rotation_flip": 0.00844594556838274,
      "sparse_tokens": 12867.0,
      "step": 6386,
      "turn_loss": 0.1839842051267624,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.2967385244378368,
      "grad_norm": 0.4311932921409607,
      "learning_rate": 4.569490279822355e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.010815839283168316,
      "mae_dx": 0.0015062346355989575,
      "mae_dy": 0.002884496934711933,
      "pose_mae_dtheta": 0.07362744212150574,
      "pose_mae_dx": 0.02383602410554886,
      "pose_mae_dy": 0.03241593763232231,
      "pose_rmse_dtheta": 0.1775323748588562,
      "pose_rmse_dx": 0.06352664530277252,
      "pose_rmse_dy": 0.0680912435054779,
      "pose_rmse_mean": 0.103050097823143,
      "rmse_dtheta": 0.021785587072372437,
      "rmse_dx": 0.004207588266581297,
      "rmse_dy": 0.005956485867500305,
      "rmse_mean": 0.010649887844920158,
      "rotation_flip": 0.0024991075042635202,
      "sparse_tokens": 32073.0,
      "step": 6387,
      "turn_loss": 0.08515535295009613,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2967849842036796,
      "grad_norm": 0.6047142744064331,
      "learning_rate": 4.568172986043236e-06,
      "loss": 0.1356,
      "mae_dtheta": 0.01288288552314043,
      "mae_dx": 0.0028398986905813217,
      "mae_dy": 0.004750376101583242,
      "pose_mae_dtheta": 0.09130649268627167,
      "pose_mae_dx": 0.039733875542879105,
      "pose_mae_dy": 0.0456654392182827,
      "pose_rmse_dtheta": 0.19138778746128082,
      "pose_rmse_dx": 0.10414029657840729,
      "pose_rmse_dy": 0.11317460983991623,
      "pose_rmse_mean": 0.13623423874378204,
      "rmse_dtheta": 0.023700403049588203,
      "rmse_dx": 0.006945911329239607,
      "rmse_dy": 0.009668952785432339,
      "rmse_mean": 0.013438422232866287,
      "rotation_flip": 0.006464124191552401,
      "sparse_tokens": 32121.0,
      "step": 6388,
      "turn_loss": 0.1271139681339264,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36013.0,
      "epoch": 0.2968314439695224,
      "grad_norm": 0.5506919622421265,
      "learning_rate": 4.566855722462009e-06,
      "loss": 0.186,
      "mae_dtheta": 0.04215140640735626,
      "mae_dx": 0.012009025551378727,
      "mae_dy": 0.00694276625290513,
      "pose_mae_dtheta": 0.32732194662094116,
      "pose_mae_dx": 0.0997801348567009,
      "pose_mae_dy": 0.07047535479068756,
      "pose_rmse_dtheta": 0.5528323650360107,
      "pose_rmse_dx": 0.20500050485134125,
      "pose_rmse_dy": 0.17010541260242462,
      "pose_rmse_mean": 0.30931276082992554,
      "rmse_dtheta": 0.060850173234939575,
      "rmse_dx": 0.023352637887001038,
      "rmse_dy": 0.015977786853909492,
      "rmse_mean": 0.033393532037734985,
      "rotation_flip": 0.011254019103944302,
      "sparse_tokens": 29713.0,
      "step": 6389,
      "turn_loss": 0.3361786901950836,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.29687790373536516,
      "grad_norm": 0.7963321805000305,
      "learning_rate": 4.565538489170797e-06,
      "loss": 0.263,
      "mae_dtheta": 0.030575161799788475,
      "mae_dx": 0.011079678311944008,
      "mae_dy": 0.004942940082401037,
      "pose_mae_dtheta": 0.22569137811660767,
      "pose_mae_dx": 0.09206787496805191,
      "pose_mae_dy": 0.06240316852927208,
      "pose_rmse_dtheta": 0.39771202206611633,
      "pose_rmse_dx": 0.18638764321804047,
      "pose_rmse_dy": 0.1464320570230484,
      "pose_rmse_mean": 0.24351057410240173,
      "rmse_dtheta": 0.04695824533700943,
      "rmse_dx": 0.022756312042474747,
      "rmse_dy": 0.009958743117749691,
      "rmse_mean": 0.026557769626379013,
      "rotation_flip": 0.012810851447284222,
      "sparse_tokens": 20886.0,
      "step": 6390,
      "turn_loss": 0.25130119919776917,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.29692436350120793,
      "grad_norm": 0.33800771832466125,
      "learning_rate": 4.564221286261709e-06,
      "loss": 0.0773,
      "mae_dtheta": 0.008758500218391418,
      "mae_dx": 0.0014962798450142145,
      "mae_dy": 0.0016933911247178912,
      "pose_mae_dtheta": 0.05975388363003731,
      "pose_mae_dx": 0.019446132704615593,
      "pose_mae_dy": 0.02370527572929859,
      "pose_rmse_dtheta": 0.16540703177452087,
      "pose_rmse_dx": 0.07373393326997757,
      "pose_rmse_dy": 0.07222247123718262,
      "pose_rmse_mean": 0.10378780961036682,
      "rmse_dtheta": 0.021761002019047737,
      "rmse_dx": 0.006311058532446623,
      "rmse_dy": 0.004593441262841225,
      "rmse_mean": 0.010888501070439816,
      "rotation_flip": 0.003201707499101758,
      "sparse_tokens": 32041.0,
      "step": 6391,
      "turn_loss": 0.06562922894954681,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2969708232670507,
      "grad_norm": 0.4005856513977051,
      "learning_rate": 4.562904113826863e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.00828704796731472,
      "mae_dx": 0.0021202429197728634,
      "mae_dy": 0.002612507436424494,
      "pose_mae_dtheta": 0.06209716945886612,
      "pose_mae_dx": 0.025048132985830307,
      "pose_mae_dy": 0.026613928377628326,
      "pose_rmse_dtheta": 0.14981046319007874,
      "pose_rmse_dx": 0.07776088267564774,
      "pose_rmse_dy": 0.07399792969226837,
      "pose_rmse_mean": 0.10052309930324554,
      "rmse_dtheta": 0.0203029103577137,
      "rmse_dx": 0.0060146101750433445,
      "rmse_dy": 0.007203277200460434,
      "rmse_mean": 0.01117359846830368,
      "rotation_flip": 0.004887585528194904,
      "sparse_tokens": 32105.0,
      "step": 6392,
      "turn_loss": 0.07735271006822586,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.2970172830328935,
      "grad_norm": 0.5037382245063782,
      "learning_rate": 4.561586971958364e-06,
      "loss": 0.1183,
      "mae_dtheta": 0.03188054636120796,
      "mae_dx": 0.010150331072509289,
      "mae_dy": 0.003202807856723666,
      "pose_mae_dtheta": 0.25725409388542175,
      "pose_mae_dx": 0.075764499604702,
      "pose_mae_dy": 0.03500360623002052,
      "pose_rmse_dtheta": 0.4620174765586853,
      "pose_rmse_dx": 0.18000049889087677,
      "pose_rmse_dy": 0.08341831713914871,
      "pose_rmse_mean": 0.2418120950460434,
      "rmse_dtheta": 0.04973454400897026,
      "rmse_dx": 0.021623097360134125,
      "rmse_dy": 0.0066740852780640125,
      "rmse_mean": 0.026010576635599136,
      "rotation_flip": 0.0117647061124444,
      "sparse_tokens": 18354.0,
      "step": 6393,
      "turn_loss": 0.2010137438774109,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2970637427987363,
      "grad_norm": 0.5311628580093384,
      "learning_rate": 4.560269860748325e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.013517920859158039,
      "mae_dx": 0.0022722261492162943,
      "mae_dy": 0.003059587674215436,
      "pose_mae_dtheta": 0.0981786921620369,
      "pose_mae_dx": 0.029032398015260696,
      "pose_mae_dy": 0.036129552870988846,
      "pose_rmse_dtheta": 0.2100696861743927,
      "pose_rmse_dx": 0.08146099001169205,
      "pose_rmse_dy": 0.0840919092297554,
      "pose_rmse_mean": 0.12520752847194672,
      "rmse_dtheta": 0.025588812306523323,
      "rmse_dx": 0.00670944107696414,
      "rmse_dy": 0.007057966664433479,
      "rmse_mean": 0.013118739239871502,
      "rotation_flip": 0.0065645514987409115,
      "sparse_tokens": 32089.0,
      "step": 6394,
      "turn_loss": 0.09755196422338486,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2971102025645791,
      "grad_norm": 0.6834495663642883,
      "learning_rate": 4.558952780288851e-06,
      "loss": 0.122,
      "mae_dtheta": 0.008691276423633099,
      "mae_dx": 0.002367972396314144,
      "mae_dy": 0.0022705532610416412,
      "pose_mae_dtheta": 0.06066754460334778,
      "pose_mae_dx": 0.02690712921321392,
      "pose_mae_dy": 0.02498941496014595,
      "pose_rmse_dtheta": 0.1752459704875946,
      "pose_rmse_dx": 0.07925471663475037,
      "pose_rmse_dy": 0.06780004501342773,
      "pose_rmse_mean": 0.10743357986211777,
      "rmse_dtheta": 0.02171246148645878,
      "rmse_dx": 0.007517529185861349,
      "rmse_dy": 0.0060335975140333176,
      "rmse_mean": 0.011754530481994152,
      "rotation_flip": 0.0025284450966864824,
      "sparse_tokens": 32121.0,
      "step": 6395,
      "turn_loss": 0.0809706449508667,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2971566623304219,
      "grad_norm": 0.4898340702056885,
      "learning_rate": 4.557635730672045e-06,
      "loss": 0.1167,
      "mae_dtheta": 0.00994640402495861,
      "mae_dx": 0.002069433918222785,
      "mae_dy": 0.0022694217041134834,
      "pose_mae_dtheta": 0.06805187463760376,
      "pose_mae_dx": 0.02554108388721943,
      "pose_mae_dy": 0.026924390345811844,
      "pose_rmse_dtheta": 0.16120411455631256,
      "pose_rmse_dx": 0.0882139578461647,
      "pose_rmse_dy": 0.06295079737901688,
      "pose_rmse_mean": 0.10412295907735825,
      "rmse_dtheta": 0.0217435322701931,
      "rmse_dx": 0.006646431516855955,
      "rmse_dy": 0.005868847481906414,
      "rmse_mean": 0.011419604532420635,
      "rotation_flip": 0.00909090880304575,
      "sparse_tokens": 32089.0,
      "step": 6396,
      "turn_loss": 0.08101315051317215,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.29720312209626465,
      "grad_norm": 0.47630780935287476,
      "learning_rate": 4.55631871199001e-06,
      "loss": 0.1208,
      "mae_dtheta": 0.013733278028666973,
      "mae_dx": 0.001923598931171,
      "mae_dy": 0.0024277151096612215,
      "pose_mae_dtheta": 0.09131238609552383,
      "pose_mae_dx": 0.027996670454740524,
      "pose_mae_dy": 0.03506466746330261,
      "pose_rmse_dtheta": 0.215890571475029,
      "pose_rmse_dx": 0.07286116480827332,
      "pose_rmse_dy": 0.09036681056022644,
      "pose_rmse_mean": 0.12637284398078918,
      "rmse_dtheta": 0.02982526645064354,
      "rmse_dx": 0.0051341187208890915,
      "rmse_dy": 0.005549381487071514,
      "rmse_mean": 0.013502921909093857,
      "rotation_flip": 0.0026626093313097954,
      "sparse_tokens": 32137.0,
      "step": 6397,
      "turn_loss": 0.09943485260009766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27816.0,
      "epoch": 0.2972495818621074,
      "grad_norm": 0.48446449637413025,
      "learning_rate": 4.555001724334847e-06,
      "loss": 0.1433,
      "mae_dtheta": 0.03158075362443924,
      "mae_dx": 0.012351916171610355,
      "mae_dy": 0.007358223665505648,
      "pose_mae_dtheta": 0.24755214154720306,
      "pose_mae_dx": 0.1010592058300972,
      "pose_mae_dy": 0.09215360879898071,
      "pose_rmse_dtheta": 0.38777491450309753,
      "pose_rmse_dx": 0.2036355584859848,
      "pose_rmse_dy": 0.1834077090024948,
      "pose_rmse_mean": 0.2582727372646332,
      "rmse_dtheta": 0.04590977728366852,
      "rmse_dx": 0.02379908785223961,
      "rmse_dy": 0.014232235960662365,
      "rmse_mean": 0.027980368584394455,
      "rotation_flip": 0.016730038449168205,
      "sparse_tokens": 22174.0,
      "step": 6398,
      "turn_loss": 0.317592054605484,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.2972960416279502,
      "grad_norm": 1.0828059911727905,
      "learning_rate": 4.553684767798649e-06,
      "loss": 0.2518,
      "mae_dtheta": 0.02786078117787838,
      "mae_dx": 0.012751569971442223,
      "mae_dy": 0.005438801366835833,
      "pose_mae_dtheta": 0.2074817419052124,
      "pose_mae_dx": 0.10300164669752121,
      "pose_mae_dy": 0.06289806962013245,
      "pose_rmse_dtheta": 0.34552285075187683,
      "pose_rmse_dx": 0.22796958684921265,
      "pose_rmse_dy": 0.14364875853061676,
      "pose_rmse_mean": 0.23904705047607422,
      "rmse_dtheta": 0.04199237748980522,
      "rmse_dx": 0.025552820414304733,
      "rmse_dy": 0.010682936757802963,
      "rmse_mean": 0.026076044887304306,
      "rotation_flip": 0.013221153989434242,
      "sparse_tokens": 13845.0,
      "step": 6399,
      "turn_loss": 0.22807490825653076,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.297342501393793,
      "grad_norm": 0.5824670195579529,
      "learning_rate": 4.552367842473518e-06,
      "loss": 0.1227,
      "mae_dtheta": 0.008030371740460396,
      "mae_dx": 0.0016100630164146423,
      "mae_dy": 0.0015006897738203406,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5824671983718872,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.189208984375,
      "model/head/act_norm_mean": 121.74300623421718,
      "model/head/act_norm_min": 59.86147689819336,
      "model/head/act_over_embed": 83.66293366013588,
      "model/head/grad_frac": 0.0833442285656929,
      "model/head/grad_norm": 0.04854527860879898,
      "model/head/grad_zero_frac": 0.00017957581439986825,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6997810132575758,
      "model/head/update_ratio": 0.0008287810487672687,
      "model/head/weight_delta": 9.133840560913086,
      "model/head/weight_delta_rel": 0.16023461520671844,
      "model/head/weight_norm": 58.574310302734375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42122915387153625,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4211712646484375,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42110103368759155,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28943283613390997,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11309874802827835,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0658763125538826,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5185763888888889,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0021287142299115658,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9477803707122803,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09631317108869553,
      "model/modality_embedder.encoders.pose/weight_norm": 30.94652557373047,
      "model/modality_embedder/grad_frac": 0.11309874802827835,
      "model/modality_embedder/grad_norm": 0.0658763125538826,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5185763888888889,
      "model/modality_embedder/update_ratio": 0.0021287142299115658,
      "model/modality_embedder/weight_delta": 2.9477803707122803,
      "model/modality_embedder/weight_delta_rel": 0.09631317108869553,
      "model/modality_embedder/weight_norm": 30.94652557373047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.74826049804688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.75361000881834,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.04062557220459,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.0109125450081,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05571657046675682,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03245307505130768,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011641628807410598,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3565962314605713,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08587578684091568,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.876747131347656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.98218536376953,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.788525132275133,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.108351707458496,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.722115906875647,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05202580243349075,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03030332364141941,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002975710085593164,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010226357262581587,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.9875710010528564,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10349179804325104,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.632570266723633,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.49275970458984,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.650310145101813,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.220452308654785,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.00155199799605,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05286882817745209,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030794357880949974,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001006548060104251,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.2217469215393066,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10818023234605789,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.594024658203125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.41731262207031,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.392073011864678,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.167986869812012,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.198507746676363,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05491049587726593,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03198356181383133,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010717266704887152,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7544803619384766,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09413506835699081,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.843021392822266,
      "model/normalizer/grad_frac": 0.2016494870185852,
      "model/normalizer/grad_norm": 0.11745420843362808,
      "model/normalizer/grad_zero_frac": 0.0002410746383247897,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001496187294833362,
      "model/normalizer/weight_delta": 5.828811168670654,
      "model/normalizer/weight_delta_rel": 0.07507171481847763,
      "model/normalizer/weight_norm": 78.5023422241211,
      "pose_mae_dtheta": 0.056116215884685516,
      "pose_mae_dx": 0.01873374916613102,
      "pose_mae_dy": 0.021734902635216713,
      "pose_rmse_dtheta": 0.13609758019447327,
      "pose_rmse_dx": 0.05081629380583763,
      "pose_rmse_dy": 0.061378102749586105,
      "pose_rmse_mean": 0.08276399970054626,
      "rmse_dtheta": 0.018405575305223465,
      "rmse_dx": 0.005483380984514952,
      "rmse_dy": 0.003356337081640959,
      "rmse_mean": 0.009081765078008175,
      "rotation_flip": 0.0017706949729472399,
      "sparse_tokens": 32121.0,
      "step": 6400,
      "turn_loss": 0.06820474565029144,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.297342501393793,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31137070059776306,
      "eval_objectnav_nopose_mae_dtheta": 0.0400310717523098,
      "eval_objectnav_nopose_mae_dx": 0.013399534858763218,
      "eval_objectnav_nopose_mae_dy": 0.004868746269494295,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32157468795776367,
      "eval_objectnav_nopose_pose_mae_dx": 0.10731425136327744,
      "eval_objectnav_nopose_pose_mae_dy": 0.05597570911049843,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.545796275138855,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23357944190502167,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13120058178901672,
      "eval_objectnav_nopose_pose_rmse_mean": 0.303525447845459,
      "eval_objectnav_nopose_rmse_dtheta": 0.057967014610767365,
      "eval_objectnav_nopose_rmse_dx": 0.02619869075715542,
      "eval_objectnav_nopose_rmse_dy": 0.009803700260818005,
      "eval_objectnav_nopose_rmse_mean": 0.031323134899139404,
      "eval_objectnav_nopose_rotation_flip": 0.014991856180131435,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31137070059776306,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 6400
    },
    {
      "epoch": 0.297342501393793,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2798263728618622,
      "eval_objectnav_pose_mae_dtheta": 0.03569403290748596,
      "eval_objectnav_pose_mae_dx": 0.01146710105240345,
      "eval_objectnav_pose_mae_dy": 0.004612776450812817,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27311038970947266,
      "eval_objectnav_pose_pose_mae_dx": 0.09037434309720993,
      "eval_objectnav_pose_pose_mae_dy": 0.04951635003089905,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4785240888595581,
      "eval_objectnav_pose_pose_rmse_dx": 0.20858265459537506,
      "eval_objectnav_pose_pose_rmse_dy": 0.11966216564178467,
      "eval_objectnav_pose_pose_rmse_mean": 0.26892298460006714,
      "eval_objectnav_pose_rmse_dtheta": 0.05341539904475212,
      "eval_objectnav_pose_rmse_dx": 0.023753182962536812,
      "eval_objectnav_pose_rmse_dy": 0.009457643143832684,
      "eval_objectnav_pose_rmse_mean": 0.028875408694148064,
      "eval_objectnav_pose_rotation_flip": 0.015538660809397697,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2798263728618622,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 6400
    },
    {
      "epoch": 0.297342501393793,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09364469349384308,
      "eval_pointnav_mae_dtheta": 0.010315243154764175,
      "eval_pointnav_mae_dx": 0.0024813502095639706,
      "eval_pointnav_mae_dy": 0.0024395028594881296,
      "eval_pointnav_pose_mae_dtheta": 0.07120029628276825,
      "eval_pointnav_pose_mae_dx": 0.027917642146348953,
      "eval_pointnav_pose_mae_dy": 0.026899786666035652,
      "eval_pointnav_pose_rmse_dtheta": 0.1973259449005127,
      "eval_pointnav_pose_rmse_dx": 0.08527449518442154,
      "eval_pointnav_pose_rmse_dy": 0.07664806395769119,
      "eval_pointnav_pose_rmse_mean": 0.11974950134754181,
      "eval_pointnav_rmse_dtheta": 0.02511722967028618,
      "eval_pointnav_rmse_dx": 0.00786363985389471,
      "eval_pointnav_rmse_dy": 0.006542356684803963,
      "eval_pointnav_rmse_mean": 0.013174409978091717,
      "eval_pointnav_rotation_flip": 0.005326019134372473,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09364469349384308,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 6400
    },
    {
      "epoch": 0.297342501393793,
      "eval_loss": 0.22828058898448944,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.31137070059776306,
      "eval_objectnav_nopose_mae_dtheta": 0.0400310717523098,
      "eval_objectnav_nopose_mae_dx": 0.013399534858763218,
      "eval_objectnav_nopose_mae_dy": 0.004868746269494295,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32157468795776367,
      "eval_objectnav_nopose_pose_mae_dx": 0.10731425136327744,
      "eval_objectnav_nopose_pose_mae_dy": 0.05597570911049843,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.545796275138855,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23357944190502167,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13120058178901672,
      "eval_objectnav_nopose_pose_rmse_mean": 0.303525447845459,
      "eval_objectnav_nopose_rmse_dtheta": 0.057967014610767365,
      "eval_objectnav_nopose_rmse_dx": 0.02619869075715542,
      "eval_objectnav_nopose_rmse_dy": 0.009803700260818005,
      "eval_objectnav_nopose_rmse_mean": 0.031323134899139404,
      "eval_objectnav_nopose_rotation_flip": 0.014991856180131435,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.31137070059776306,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2798263728618622,
      "eval_objectnav_pose_mae_dtheta": 0.03569403290748596,
      "eval_objectnav_pose_mae_dx": 0.01146710105240345,
      "eval_objectnav_pose_mae_dy": 0.004612776450812817,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27311038970947266,
      "eval_objectnav_pose_pose_mae_dx": 0.09037434309720993,
      "eval_objectnav_pose_pose_mae_dy": 0.04951635003089905,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4785240888595581,
      "eval_objectnav_pose_pose_rmse_dx": 0.20858265459537506,
      "eval_objectnav_pose_pose_rmse_dy": 0.11966216564178467,
      "eval_objectnav_pose_pose_rmse_mean": 0.26892298460006714,
      "eval_objectnav_pose_rmse_dtheta": 0.05341539904475212,
      "eval_objectnav_pose_rmse_dx": 0.023753182962536812,
      "eval_objectnav_pose_rmse_dy": 0.009457643143832684,
      "eval_objectnav_pose_rmse_mean": 0.028875408694148064,
      "eval_objectnav_pose_rotation_flip": 0.015538660809397697,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2798263728618622,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09364469349384308,
      "eval_pointnav_mae_dtheta": 0.010315243154764175,
      "eval_pointnav_mae_dx": 0.0024813502095639706,
      "eval_pointnav_mae_dy": 0.0024395028594881296,
      "eval_pointnav_pose_mae_dtheta": 0.07120029628276825,
      "eval_pointnav_pose_mae_dx": 0.027917642146348953,
      "eval_pointnav_pose_mae_dy": 0.026899786666035652,
      "eval_pointnav_pose_rmse_dtheta": 0.1973259449005127,
      "eval_pointnav_pose_rmse_dx": 0.08527449518442154,
      "eval_pointnav_pose_rmse_dy": 0.07664806395769119,
      "eval_pointnav_pose_rmse_mean": 0.11974950134754181,
      "eval_pointnav_rmse_dtheta": 0.02511722967028618,
      "eval_pointnav_rmse_dx": 0.00786363985389471,
      "eval_pointnav_rmse_dy": 0.006542356684803963,
      "eval_pointnav_rmse_mean": 0.013174409978091717,
      "eval_pointnav_rotation_flip": 0.005326019134372473,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09364469349384308,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 6400
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.29738896115963576,
      "grad_norm": 0.45091235637664795,
      "learning_rate": 4.551050948451542e-06,
      "loss": 0.1236,
      "mae_dtheta": 0.0292217917740345,
      "mae_dx": 0.010066920891404152,
      "mae_dy": 0.0061415559612214565,
      "pose_mae_dtheta": 0.23734484612941742,
      "pose_mae_dx": 0.09699298441410065,
      "pose_mae_dy": 0.06328557431697845,
      "pose_rmse_dtheta": 0.4272943139076233,
      "pose_rmse_dx": 0.2338462620973587,
      "pose_rmse_dy": 0.14510518312454224,
      "pose_rmse_mean": 0.26874858140945435,
      "rmse_dtheta": 0.046793099492788315,
      "rmse_dx": 0.021602239459753036,
      "rmse_dy": 0.013655767776072025,
      "rmse_mean": 0.027350369840860367,
      "rotation_flip": 0.015212169848382473,
      "sparse_tokens": 21396.0,
      "step": 6401,
      "turn_loss": 0.27543872594833374,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.29743542092547853,
      "grad_norm": 0.2794288098812103,
      "learning_rate": 4.549734085824816e-06,
      "loss": 0.0714,
      "mae_dtheta": 0.007086725439876318,
      "mae_dx": 0.0010220762342214584,
      "mae_dy": 0.0008403160609304905,
      "pose_mae_dtheta": 0.04954700544476509,
      "pose_mae_dx": 0.010796935297548771,
      "pose_mae_dy": 0.013123290613293648,
      "pose_rmse_dtheta": 0.20514532923698425,
      "pose_rmse_dx": 0.033456288278102875,
      "pose_rmse_dy": 0.04021809622645378,
      "pose_rmse_mean": 0.09293990582227707,
      "rmse_dtheta": 0.02437659725546837,
      "rmse_dx": 0.0034870717208832502,
      "rmse_dy": 0.003038437571376562,
      "rmse_mean": 0.010300702415406704,
      "rotation_flip": 0.002074688905850053,
      "sparse_tokens": 32073.0,
      "step": 6402,
      "turn_loss": 0.04955294728279114,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2974818806913213,
      "grad_norm": 0.5666103363037109,
      "learning_rate": 4.548417254685425e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.013695468194782734,
      "mae_dx": 0.0019029765389859676,
      "mae_dy": 0.004449286498129368,
      "pose_mae_dtheta": 0.09676066040992737,
      "pose_mae_dx": 0.039109669625759125,
      "pose_mae_dy": 0.05444811284542084,
      "pose_rmse_dtheta": 0.21187454462051392,
      "pose_rmse_dx": 0.1026640236377716,
      "pose_rmse_dy": 0.1344940960407257,
      "pose_rmse_mean": 0.1496775597333908,
      "rmse_dtheta": 0.026292376220226288,
      "rmse_dx": 0.005155394785106182,
      "rmse_dy": 0.00953585933893919,
      "rmse_mean": 0.013661211356520653,
      "rotation_flip": 0.0060326470993459225,
      "sparse_tokens": 32041.0,
      "step": 6403,
      "turn_loss": 0.12167586386203766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2975283404571641,
      "grad_norm": 0.463358998298645,
      "learning_rate": 4.54710045512546e-06,
      "loss": 0.1071,
      "mae_dtheta": 0.00866763386875391,
      "mae_dx": 0.001312454929575324,
      "mae_dy": 0.002362831961363554,
      "pose_mae_dtheta": 0.05384732782840729,
      "pose_mae_dx": 0.019427958875894547,
      "pose_mae_dy": 0.028115535154938698,
      "pose_rmse_dtheta": 0.1131504625082016,
      "pose_rmse_dx": 0.057435642927885056,
      "pose_rmse_dy": 0.06351261585950851,
      "pose_rmse_mean": 0.07803291082382202,
      "rmse_dtheta": 0.017866477370262146,
      "rmse_dx": 0.003883110359311104,
      "rmse_dy": 0.005521305836737156,
      "rmse_mean": 0.009090298786759377,
      "rotation_flip": 0.004120313096791506,
      "sparse_tokens": 32041.0,
      "step": 6404,
      "turn_loss": 0.07205604761838913,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.29757480022300686,
      "grad_norm": 0.5878008008003235,
      "learning_rate": 4.545783687237001e-06,
      "loss": 0.1036,
      "mae_dtheta": 0.029872365295886993,
      "mae_dx": 0.005943192634731531,
      "mae_dy": 0.0062426174990832806,
      "pose_mae_dtheta": 0.2201409488916397,
      "pose_mae_dx": 0.06487274169921875,
      "pose_mae_dy": 0.06955360621213913,
      "pose_rmse_dtheta": 0.4332655370235443,
      "pose_rmse_dx": 0.17788925766944885,
      "pose_rmse_dy": 0.17927324771881104,
      "pose_rmse_mean": 0.26347601413726807,
      "rmse_dtheta": 0.04884953051805496,
      "rmse_dx": 0.01633448898792267,
      "rmse_dy": 0.012341240420937538,
      "rmse_mean": 0.02584175392985344,
      "rotation_flip": 0.015550239011645317,
      "sparse_tokens": 14350.0,
      "step": 6405,
      "turn_loss": 0.23055242002010345,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 34283.0,
      "epoch": 0.29762125998884964,
      "grad_norm": 0.4380861222743988,
      "learning_rate": 4.544466951112132e-06,
      "loss": 0.1597,
      "mae_dtheta": 0.04123280569911003,
      "mae_dx": 0.014069439843297005,
      "mae_dy": 0.004606247413903475,
      "pose_mae_dtheta": 0.3410654664039612,
      "pose_mae_dx": 0.11639933288097382,
      "pose_mae_dy": 0.06319750100374222,
      "pose_rmse_dtheta": 0.569576621055603,
      "pose_rmse_dx": 0.23920035362243652,
      "pose_rmse_dy": 0.13497357070446014,
      "pose_rmse_mean": 0.31458353996276855,
      "rmse_dtheta": 0.0589425303041935,
      "rmse_dx": 0.0265264343470335,
      "rmse_dy": 0.008367417380213737,
      "rmse_mean": 0.03127879649400711,
      "rotation_flip": 0.01364764291793108,
      "sparse_tokens": 27678.0,
      "step": 6406,
      "turn_loss": 0.28706812858581543,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.2976677197546924,
      "grad_norm": 0.5917667150497437,
      "learning_rate": 4.543150246842937e-06,
      "loss": 0.1288,
      "mae_dtheta": 0.036980416625738144,
      "mae_dx": 0.013686873018741608,
      "mae_dy": 0.0025812117382884026,
      "pose_mae_dtheta": 0.29560723900794983,
      "pose_mae_dx": 0.09111208468675613,
      "pose_mae_dy": 0.027645520865917206,
      "pose_rmse_dtheta": 0.5669484734535217,
      "pose_rmse_dx": 0.22873066365718842,
      "pose_rmse_dy": 0.06372594833374023,
      "pose_rmse_mean": 0.28646838665008545,
      "rmse_dtheta": 0.0575975738465786,
      "rmse_dx": 0.027229061350226402,
      "rmse_dy": 0.005233761388808489,
      "rmse_mean": 0.030020132660865784,
      "rotation_flip": 0.018927445635199547,
      "sparse_tokens": 5774.0,
      "step": 6407,
      "turn_loss": 0.23562777042388916,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2977141795205352,
      "grad_norm": 0.44217464327812195,
      "learning_rate": 4.541833574521487e-06,
      "loss": 0.103,
      "mae_dtheta": 0.008823645301163197,
      "mae_dx": 0.001721703796647489,
      "mae_dy": 0.0021878795232623816,
      "pose_mae_dtheta": 0.061989933252334595,
      "pose_mae_dx": 0.020952628925442696,
      "pose_mae_dy": 0.021915551275014877,
      "pose_rmse_dtheta": 0.17870280146598816,
      "pose_rmse_dx": 0.05608551949262619,
      "pose_rmse_dy": 0.05480886995792389,
      "pose_rmse_mean": 0.09653240442276001,
      "rmse_dtheta": 0.02134268544614315,
      "rmse_dx": 0.00509217893704772,
      "rmse_dy": 0.005087775643914938,
      "rmse_mean": 0.010507546365261078,
      "rotation_flip": 0.0068618482910096645,
      "sparse_tokens": 32089.0,
      "step": 6408,
      "turn_loss": 0.07010771334171295,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.29776063928637797,
      "grad_norm": 0.5530097484588623,
      "learning_rate": 4.5405169342398634e-06,
      "loss": 0.164,
      "mae_dtheta": 0.03192044422030449,
      "mae_dx": 0.010559379123151302,
      "mae_dy": 0.004738516639918089,
      "pose_mae_dtheta": 0.2312985360622406,
      "pose_mae_dx": 0.08282020688056946,
      "pose_mae_dy": 0.059164050966501236,
      "pose_rmse_dtheta": 0.41974684596061707,
      "pose_rmse_dx": 0.1836460381746292,
      "pose_rmse_dy": 0.1420266181230545,
      "pose_rmse_mean": 0.2484731674194336,
      "rmse_dtheta": 0.048948291689157486,
      "rmse_dx": 0.022125618532299995,
      "rmse_dy": 0.008970821276307106,
      "rmse_mean": 0.026681577786803246,
      "rotation_flip": 0.02044609747827053,
      "sparse_tokens": 19435.0,
      "step": 6409,
      "turn_loss": 0.24013268947601318,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.2978070990522208,
      "grad_norm": 1.2642179727554321,
      "learning_rate": 4.5392003260901355e-06,
      "loss": 0.2691,
      "mae_dtheta": 0.02464665286242962,
      "mae_dx": 0.008494852110743523,
      "mae_dy": 0.0027885602321475744,
      "pose_mae_dtheta": 0.18857768177986145,
      "pose_mae_dx": 0.061866432428359985,
      "pose_mae_dy": 0.02788866125047207,
      "pose_rmse_dtheta": 0.3868752419948578,
      "pose_rmse_dx": 0.15224875509738922,
      "pose_rmse_dy": 0.07798859477043152,
      "pose_rmse_mean": 0.2057042121887207,
      "rmse_dtheta": 0.04312651604413986,
      "rmse_dx": 0.019375108182430267,
      "rmse_dy": 0.005669827573001385,
      "rmse_mean": 0.022723816335201263,
      "rotation_flip": 0.012861736118793488,
      "sparse_tokens": 11278.0,
      "step": 6410,
      "turn_loss": 0.19146373867988586,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 6195.0,
      "epoch": 0.2978535588180636,
      "grad_norm": 0.5859299302101135,
      "learning_rate": 4.5378837501643785e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.03156988322734833,
      "mae_dx": 0.003507089102640748,
      "mae_dy": 0.0035213034134358168,
      "pose_mae_dtheta": 0.23935467004776,
      "pose_mae_dx": 0.036442384123802185,
      "pose_mae_dy": 0.03707324340939522,
      "pose_rmse_dtheta": 0.4343245327472687,
      "pose_rmse_dx": 0.1216568574309349,
      "pose_rmse_dy": 0.09050913155078888,
      "pose_rmse_mean": 0.21549683809280396,
      "rmse_dtheta": 0.048208143562078476,
      "rmse_dx": 0.012278560549020767,
      "rmse_dy": 0.006952919531613588,
      "rmse_mean": 0.02247987501323223,
      "rotation_flip": 0.009966777637600899,
      "sparse_tokens": 4803.0,
      "step": 6411,
      "turn_loss": 0.20624522864818573,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.29790001858390636,
      "grad_norm": 0.30698737502098083,
      "learning_rate": 4.536567206554656e-06,
      "loss": 0.0757,
      "mae_dtheta": 0.009078078903257847,
      "mae_dx": 0.0014648673823103309,
      "mae_dy": 0.00035944892442785203,
      "pose_mae_dtheta": 0.06674595177173615,
      "pose_mae_dx": 0.010573796927928925,
      "pose_mae_dy": 0.006098493468016386,
      "pose_rmse_dtheta": 0.2616897523403168,
      "pose_rmse_dx": 0.025123372673988342,
      "pose_rmse_dy": 0.017301341518759727,
      "pose_rmse_mean": 0.10137149691581726,
      "rmse_dtheta": 0.031125526875257492,
      "rmse_dx": 0.0042106108739972115,
      "rmse_dy": 0.0007888437248766422,
      "rmse_mean": 0.012041660957038403,
      "rotation_flip": 0.0030413626227527857,
      "sparse_tokens": 32217.0,
      "step": 6412,
      "turn_loss": 0.05115525424480438,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.29794647834974913,
      "grad_norm": 0.5081392526626587,
      "learning_rate": 4.53525069535304e-06,
      "loss": 0.1337,
      "mae_dtheta": 0.017414866015315056,
      "mae_dx": 0.004566943738609552,
      "mae_dy": 0.006501392927020788,
      "pose_mae_dtheta": 0.13515736162662506,
      "pose_mae_dx": 0.04880838841199875,
      "pose_mae_dy": 0.0551227405667305,
      "pose_rmse_dtheta": 0.32574349641799927,
      "pose_rmse_dx": 0.14278599619865417,
      "pose_rmse_dy": 0.16437110304832458,
      "pose_rmse_mean": 0.21096687018871307,
      "rmse_dtheta": 0.03521952033042908,
      "rmse_dx": 0.012149066664278507,
      "rmse_dy": 0.01630786806344986,
      "rmse_mean": 0.02122548595070839,
      "rotation_flip": 0.009405568242073059,
      "sparse_tokens": 32105.0,
      "step": 6413,
      "turn_loss": 0.17371290922164917,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.2979929381155919,
      "grad_norm": 0.3944876790046692,
      "learning_rate": 4.533934216651591e-06,
      "loss": 0.0695,
      "mae_dtheta": 0.007380643859505653,
      "mae_dx": 0.0017342498758807778,
      "mae_dy": 0.001642224844545126,
      "pose_mae_dtheta": 0.05348082631826401,
      "pose_mae_dx": 0.02032441645860672,
      "pose_mae_dy": 0.02118103578686714,
      "pose_rmse_dtheta": 0.13661500811576843,
      "pose_rmse_dx": 0.06412588804960251,
      "pose_rmse_dy": 0.057386454194784164,
      "pose_rmse_mean": 0.08604245632886887,
      "rmse_dtheta": 0.016881702467799187,
      "rmse_dx": 0.006142918951809406,
      "rmse_dy": 0.004770867060869932,
      "rmse_mean": 0.009265163913369179,
      "rotation_flip": 0.004081632476300001,
      "sparse_tokens": 32121.0,
      "step": 6414,
      "turn_loss": 0.07313568145036697,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26609.0,
      "epoch": 0.2980393978814347,
      "grad_norm": 0.5086573362350464,
      "learning_rate": 4.5326177705423725e-06,
      "loss": 0.1297,
      "mae_dtheta": 0.03805670514702797,
      "mae_dx": 0.01200820505619049,
      "mae_dy": 0.0037543154321610928,
      "pose_mae_dtheta": 0.2991447150707245,
      "pose_mae_dx": 0.08954378217458725,
      "pose_mae_dy": 0.043032072484493256,
      "pose_rmse_dtheta": 0.522496223449707,
      "pose_rmse_dx": 0.2027035653591156,
      "pose_rmse_dy": 0.09889064729213715,
      "pose_rmse_mean": 0.27469682693481445,
      "rmse_dtheta": 0.05712422356009483,
      "rmse_dx": 0.024456365033984184,
      "rmse_dy": 0.007521075662225485,
      "rmse_mean": 0.02970055490732193,
      "rotation_flip": 0.009146341122686863,
      "sparse_tokens": 20587.0,
      "step": 6415,
      "turn_loss": 0.25204727053642273,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.29808585764727746,
      "grad_norm": 0.5240934491157532,
      "learning_rate": 4.531301357117444e-06,
      "loss": 0.1625,
      "mae_dtheta": 0.03156589716672897,
      "mae_dx": 0.012846852652728558,
      "mae_dy": 0.006962055806070566,
      "pose_mae_dtheta": 0.21879345178604126,
      "pose_mae_dx": 0.09872274845838547,
      "pose_mae_dy": 0.07545817643404007,
      "pose_rmse_dtheta": 0.37629252672195435,
      "pose_rmse_dx": 0.20431579649448395,
      "pose_rmse_dy": 0.16557446122169495,
      "pose_rmse_mean": 0.24872760474681854,
      "rmse_dtheta": 0.04764585569500923,
      "rmse_dx": 0.02523813769221306,
      "rmse_dy": 0.013601034879684448,
      "rmse_mean": 0.028828343376517296,
      "rotation_flip": 0.024771837517619133,
      "sparse_tokens": 13289.0,
      "step": 6416,
      "turn_loss": 0.3411681652069092,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.29813231741312024,
      "grad_norm": 0.5781046152114868,
      "learning_rate": 4.529984976468864e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.03161609172821045,
      "mae_dx": 0.008841481991112232,
      "mae_dy": 0.004201086238026619,
      "pose_mae_dtheta": 0.25499704480171204,
      "pose_mae_dx": 0.06311905384063721,
      "pose_mae_dy": 0.048163674771785736,
      "pose_rmse_dtheta": 0.4790779650211334,
      "pose_rmse_dx": 0.16799946129322052,
      "pose_rmse_dy": 0.11153219640254974,
      "pose_rmse_mean": 0.2528699040412903,
      "rmse_dtheta": 0.04943768307566643,
      "rmse_dx": 0.01986636035144329,
      "rmse_dy": 0.008239788003265858,
      "rmse_mean": 0.025847945362329483,
      "rotation_flip": 0.024344569072127342,
      "sparse_tokens": 10635.0,
      "step": 6417,
      "turn_loss": 0.24538558721542358,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.298178777178963,
      "grad_norm": 0.993317186832428,
      "learning_rate": 4.528668628688685e-06,
      "loss": 0.2421,
      "mae_dtheta": 0.04339505732059479,
      "mae_dx": 0.010072551667690277,
      "mae_dy": 0.005853590089827776,
      "pose_mae_dtheta": 0.3923586905002594,
      "pose_mae_dx": 0.10464949905872345,
      "pose_mae_dy": 0.09730081260204315,
      "pose_rmse_dtheta": 0.6637424230575562,
      "pose_rmse_dx": 0.20591211318969727,
      "pose_rmse_dy": 0.20761582255363464,
      "pose_rmse_mean": 0.3590901494026184,
      "rmse_dtheta": 0.06253492087125778,
      "rmse_dx": 0.021130502223968506,
      "rmse_dy": 0.010269825346767902,
      "rmse_mean": 0.031311750411987305,
      "rotation_flip": 0.0031152646988630295,
      "sparse_tokens": 5549.0,
      "step": 6418,
      "turn_loss": 0.24156376719474792,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.2982252369448058,
      "grad_norm": 0.7156268358230591,
      "learning_rate": 4.5273523138689645e-06,
      "loss": 0.1263,
      "mae_dtheta": 0.03588255122303963,
      "mae_dx": 0.009396194480359554,
      "mae_dy": 0.005569992586970329,
      "pose_mae_dtheta": 0.26709479093551636,
      "pose_mae_dx": 0.08321513235569,
      "pose_mae_dy": 0.05590452998876572,
      "pose_rmse_dtheta": 0.4792136549949646,
      "pose_rmse_dx": 0.1875278800725937,
      "pose_rmse_dy": 0.1201530322432518,
      "pose_rmse_mean": 0.26229819655418396,
      "rmse_dtheta": 0.05245121940970421,
      "rmse_dx": 0.020343532785773277,
      "rmse_dy": 0.0105179687961936,
      "rmse_mean": 0.027770906686782837,
      "rotation_flip": 0.015558699145913124,
      "sparse_tokens": 12444.0,
      "step": 6419,
      "turn_loss": 0.24958166480064392,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.29827169671064857,
      "grad_norm": 0.6812394261360168,
      "learning_rate": 4.526036032101748e-06,
      "loss": 0.1023,
      "mae_dtheta": 0.041254911571741104,
      "mae_dx": 0.013019206933677197,
      "mae_dy": 0.0022187780123203993,
      "pose_mae_dtheta": 0.30219966173171997,
      "pose_mae_dx": 0.11151071637868881,
      "pose_mae_dy": 0.028824733570218086,
      "pose_rmse_dtheta": 0.5658159852027893,
      "pose_rmse_dx": 0.24705109000205994,
      "pose_rmse_dy": 0.0732082948088646,
      "pose_rmse_mean": 0.29535844922065735,
      "rmse_dtheta": 0.06564725190401077,
      "rmse_dx": 0.02672228403389454,
      "rmse_dy": 0.004778960719704628,
      "rmse_mean": 0.03238283097743988,
      "rotation_flip": 0.018927445635199547,
      "sparse_tokens": 5454.0,
      "step": 6420,
      "turn_loss": 0.18982356786727905,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.29831815647649135,
      "grad_norm": 0.4982561767101288,
      "learning_rate": 4.524719783479088e-06,
      "loss": 0.1328,
      "mae_dtheta": 0.007476302329450846,
      "mae_dx": 0.0021568876691162586,
      "mae_dy": 0.002673495328053832,
      "pose_mae_dtheta": 0.04867732152342796,
      "pose_mae_dx": 0.029906930401921272,
      "pose_mae_dy": 0.02290891855955124,
      "pose_rmse_dtheta": 0.1025904044508934,
      "pose_rmse_dx": 0.07255200296640396,
      "pose_rmse_dy": 0.05217970162630081,
      "pose_rmse_mean": 0.07577403634786606,
      "rmse_dtheta": 0.01631877012550831,
      "rmse_dx": 0.0052245124243199825,
      "rmse_dy": 0.005746126640588045,
      "rmse_mean": 0.009096469730138779,
      "rotation_flip": 0.005319148767739534,
      "sparse_tokens": 32169.0,
      "step": 6421,
      "turn_loss": 0.07496057450771332,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2983646162423341,
      "grad_norm": 0.43474072217941284,
      "learning_rate": 4.523403568093026e-06,
      "loss": 0.108,
      "mae_dtheta": 0.012733139097690582,
      "mae_dx": 0.0019703751895576715,
      "mae_dy": 0.0037646815180778503,
      "pose_mae_dtheta": 0.09387633204460144,
      "pose_mae_dx": 0.02941829524934292,
      "pose_mae_dy": 0.042588043957948685,
      "pose_rmse_dtheta": 0.20562542974948883,
      "pose_rmse_dx": 0.0727936327457428,
      "pose_rmse_dy": 0.0991775244474411,
      "pose_rmse_mean": 0.12586554884910583,
      "rmse_dtheta": 0.024433612823486328,
      "rmse_dx": 0.005733472295105457,
      "rmse_dy": 0.008205395191907883,
      "rmse_mean": 0.012790827080607414,
      "rotation_flip": 0.005477576050907373,
      "sparse_tokens": 32089.0,
      "step": 6422,
      "turn_loss": 0.11223939806222916,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.2984110760081769,
      "grad_norm": 0.3874909281730652,
      "learning_rate": 4.522087386035612e-06,
      "loss": 0.0785,
      "mae_dtheta": 0.007458873558789492,
      "mae_dx": 0.0012842430733144283,
      "mae_dy": 0.0015158177120611072,
      "pose_mae_dtheta": 0.05210111290216446,
      "pose_mae_dx": 0.016807548701763153,
      "pose_mae_dy": 0.017305398359894753,
      "pose_rmse_dtheta": 0.1727174073457718,
      "pose_rmse_dx": 0.04696202650666237,
      "pose_rmse_dy": 0.04423186555504799,
      "pose_rmse_mean": 0.08797043561935425,
      "rmse_dtheta": 0.02137679047882557,
      "rmse_dx": 0.003907458391040564,
      "rmse_dy": 0.0038955798372626305,
      "rmse_mean": 0.009726610034704208,
      "rotation_flip": 0.002189141931012273,
      "sparse_tokens": 32137.0,
      "step": 6423,
      "turn_loss": 0.057283833622932434,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.2984575357740197,
      "grad_norm": 0.6861644387245178,
      "learning_rate": 4.52077123739888e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.051057469099760056,
      "mae_dx": 0.012608339078724384,
      "mae_dy": 0.0035791394766420126,
      "pose_mae_dtheta": 0.4532850384712219,
      "pose_mae_dx": 0.10843774676322937,
      "pose_mae_dy": 0.04601185768842697,
      "pose_rmse_dtheta": 0.7311510443687439,
      "pose_rmse_dx": 0.22766268253326416,
      "pose_rmse_dy": 0.10806344449520111,
      "pose_rmse_mean": 0.355625718832016,
      "rmse_dtheta": 0.07186628878116608,
      "rmse_dx": 0.02483319118618965,
      "rmse_dy": 0.007179535459727049,
      "rmse_mean": 0.03462633863091469,
      "rotation_flip": 0.013698630034923553,
      "sparse_tokens": 10528.0,
      "step": 6424,
      "turn_loss": 0.2860737442970276,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.29850399553986245,
      "grad_norm": 0.5863335132598877,
      "learning_rate": 4.519455122274874e-06,
      "loss": 0.1073,
      "mae_dtheta": 0.025865694507956505,
      "mae_dx": 0.011817138642072678,
      "mae_dy": 0.007043409626930952,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5863334536552429,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.29409790039062,
      "model/head/act_norm_mean": 114.11001275510205,
      "model/head/act_norm_min": 66.4850845336914,
      "model/head/act_over_embed": 78.41746908007711,
      "model/head/grad_frac": 0.09239747375249863,
      "model/head/grad_norm": 0.0541757307946682,
      "model/head/grad_zero_frac": 0.00016402950859628618,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6993781887755102,
      "model/head/update_ratio": 0.0009248633868992329,
      "model/head/weight_delta": 9.145756721496582,
      "model/head/weight_delta_rel": 0.16044366359710693,
      "model/head/weight_norm": 58.57700729370117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4212651252746582,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4212651252746582,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4212651252746582,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28949733803498584,
      "model/modality_embedder.encoders.pose/grad_frac": 0.051199473440647125,
      "model/modality_embedder.encoders.pose/grad_norm": 0.030019963160157204,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009700373630039394,
      "model/modality_embedder.encoders.pose/weight_delta": 2.948820114135742,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0963471457362175,
      "model/modality_embedder.encoders.pose/weight_norm": 30.947223663330078,
      "model/modality_embedder/grad_frac": 0.051199473440647125,
      "model/modality_embedder/grad_norm": 0.030019963160157204,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0009700373630039394,
      "model/modality_embedder/weight_delta": 2.948820114135742,
      "model/modality_embedder/weight_delta_rel": 0.0963471457362175,
      "model/modality_embedder/weight_norm": 30.947223663330078,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.88200378417969,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.000384677680596,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.159799575805664,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.49328904564359,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07663941383361816,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.044936250895261765,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016118643106892705,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.361956834793091,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08607113361358643,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.878433227539062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.22620391845703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.816334122934887,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.525172233581543,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.054017143461397,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0716584175825119,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04201572760939598,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014177869306877255,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.993722915649414,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10370489954948425,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.63472557067871,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.68873596191406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.404966897473276,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.55080509185791,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.145740459138544,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06874731928110123,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04030885174870491,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013174422783777118,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.2286412715911865,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10841172933578491,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.596294403076172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.21875762939453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.27959993521218,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.338774681091309,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.43400583326373,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08120379596948624,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0476125031709671,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015953241381794214,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7605626583099365,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09434293210506439,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.845033645629883,
      "model/normalizer/grad_frac": 0.3321562707424164,
      "model/normalizer/grad_norm": 0.19475433230400085,
      "model/normalizer/grad_zero_frac": 0.00019144162070006132,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0024807918816804886,
      "model/normalizer/weight_delta": 5.841369152069092,
      "model/normalizer/weight_delta_rel": 0.07523345202207565,
      "model/normalizer/weight_norm": 78.5049057006836,
      "pose_mae_dtheta": 0.20673033595085144,
      "pose_mae_dx": 0.09645433723926544,
      "pose_mae_dy": 0.08011997491121292,
      "pose_rmse_dtheta": 0.3452887237071991,
      "pose_rmse_dx": 0.2296454757452011,
      "pose_rmse_dy": 0.18966352939605713,
      "pose_rmse_mean": 0.2548659145832062,
      "rmse_dtheta": 0.04122711718082428,
      "rmse_dx": 0.02445879951119423,
      "rmse_dy": 0.01623082160949707,
      "rmse_mean": 0.02730557881295681,
      "rotation_flip": 0.014996053650975227,
      "sparse_tokens": 25312.0,
      "step": 6425,
      "turn_loss": 0.26966533064842224,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.2985504553057053,
      "grad_norm": 0.4249465763568878,
      "learning_rate": 4.518139040755631e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.015949681401252747,
      "mae_dx": 0.0027380799874663353,
      "mae_dy": 0.003599554067477584,
      "pose_mae_dtheta": 0.10936370491981506,
      "pose_mae_dx": 0.03267857804894447,
      "pose_mae_dy": 0.039356108754873276,
      "pose_rmse_dtheta": 0.23450955748558044,
      "pose_rmse_dx": 0.07644865661859512,
      "pose_rmse_dy": 0.07600562274456024,
      "pose_rmse_mean": 0.12898795306682587,
      "rmse_dtheta": 0.02824961394071579,
      "rmse_dx": 0.007941980846226215,
      "rmse_dy": 0.00722651369869709,
      "rmse_mean": 0.014472703449428082,
      "rotation_flip": 0.0037325038574635983,
      "sparse_tokens": 32153.0,
      "step": 6426,
      "turn_loss": 0.1263841837644577,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.29859691507154806,
      "grad_norm": 0.4094146192073822,
      "learning_rate": 4.5168229929331805e-06,
      "loss": 0.0779,
      "mae_dtheta": 0.007263419684022665,
      "mae_dx": 0.0013106086989864707,
      "mae_dy": 0.001729099196381867,
      "pose_mae_dtheta": 0.04774381220340729,
      "pose_mae_dx": 0.018234780058264732,
      "pose_mae_dy": 0.02108602784574032,
      "pose_rmse_dtheta": 0.11220770329236984,
      "pose_rmse_dx": 0.05641327425837517,
      "pose_rmse_dy": 0.049944210797548294,
      "pose_rmse_mean": 0.07285506278276443,
      "rmse_dtheta": 0.018064985051751137,
      "rmse_dx": 0.0042400783859193325,
      "rmse_dy": 0.004603697918355465,
      "rmse_mean": 0.008969588205218315,
      "rotation_flip": 0.005376344081014395,
      "sparse_tokens": 32073.0,
      "step": 6427,
      "turn_loss": 0.05702454596757889,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28786.0,
      "epoch": 0.29864337483739084,
      "grad_norm": 0.8657917380332947,
      "learning_rate": 4.51550697889956e-06,
      "loss": 0.1769,
      "mae_dtheta": 0.0386519618332386,
      "mae_dx": 0.01510008703917265,
      "mae_dy": 0.006843014620244503,
      "pose_mae_dtheta": 0.3184034824371338,
      "pose_mae_dx": 0.11052897572517395,
      "pose_mae_dy": 0.06536238640546799,
      "pose_rmse_dtheta": 0.5500758290290833,
      "pose_rmse_dx": 0.24066802859306335,
      "pose_rmse_dy": 0.17221243679523468,
      "pose_rmse_mean": 0.32098543643951416,
      "rmse_dtheta": 0.05754793435335159,
      "rmse_dx": 0.02827593870460987,
      "rmse_dy": 0.0162536408752203,
      "rmse_mean": 0.03402584046125412,
      "rotation_flip": 0.019622093066573143,
      "sparse_tokens": 22491.0,
      "step": 6428,
      "turn_loss": 0.36128538846969604,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.2986898346032336,
      "grad_norm": 0.8523623943328857,
      "learning_rate": 4.514190998746795e-06,
      "loss": 0.0836,
      "mae_dtheta": 0.01379175204783678,
      "mae_dx": 0.008542262949049473,
      "mae_dy": 0.0013561780797317624,
      "pose_mae_dtheta": 0.10400371998548508,
      "pose_mae_dx": 0.056825656443834305,
      "pose_mae_dy": 0.019586222246289253,
      "pose_rmse_dtheta": 0.24315384030342102,
      "pose_rmse_dx": 0.20308707654476166,
      "pose_rmse_dy": 0.062227122485637665,
      "pose_rmse_mean": 0.16948935389518738,
      "rmse_dtheta": 0.02862834371626377,
      "rmse_dx": 0.022825540974736214,
      "rmse_dy": 0.003228457411751151,
      "rmse_mean": 0.01822744682431221,
      "rotation_flip": 0.01984127052128315,
      "sparse_tokens": 8009.0,
      "step": 6429,
      "turn_loss": 0.10935001075267792,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.2987362943690764,
      "grad_norm": 0.7398229837417603,
      "learning_rate": 4.512875052566915e-06,
      "loss": 0.1461,
      "mae_dtheta": 0.019829459488391876,
      "mae_dx": 0.0060727233067154884,
      "mae_dy": 0.002904698718339205,
      "pose_mae_dtheta": 0.18688835203647614,
      "pose_mae_dx": 0.0460570864379406,
      "pose_mae_dy": 0.026797650381922722,
      "pose_rmse_dtheta": 0.35925841331481934,
      "pose_rmse_dx": 0.09481287747621536,
      "pose_rmse_dy": 0.05944588780403137,
      "pose_rmse_mean": 0.1711723804473877,
      "rmse_dtheta": 0.0340883806347847,
      "rmse_dx": 0.012123526073992252,
      "rmse_dy": 0.005369320511817932,
      "rmse_mean": 0.017193742096424103,
      "rotation_flip": 0.0,
      "sparse_tokens": 3639.0,
      "step": 6430,
      "turn_loss": 0.19616802036762238,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.29878275413491917,
      "grad_norm": 0.47934356331825256,
      "learning_rate": 4.5115591404519435e-06,
      "loss": 0.1052,
      "mae_dtheta": 0.03387027978897095,
      "mae_dx": 0.008636019192636013,
      "mae_dy": 0.004407733678817749,
      "pose_mae_dtheta": 0.2791503965854645,
      "pose_mae_dx": 0.07449417561292648,
      "pose_mae_dy": 0.051443248987197876,
      "pose_rmse_dtheta": 0.5034840106964111,
      "pose_rmse_dx": 0.17214658856391907,
      "pose_rmse_dy": 0.11934779584407806,
      "pose_rmse_mean": 0.2649928033351898,
      "rmse_dtheta": 0.05280289053916931,
      "rmse_dx": 0.0187617689371109,
      "rmse_dy": 0.009509900584816933,
      "rmse_mean": 0.027024853974580765,
      "rotation_flip": 0.010761589743196964,
      "sparse_tokens": 22708.0,
      "step": 6431,
      "turn_loss": 0.24350179731845856,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.29882921390076195,
      "grad_norm": 0.7634419202804565,
      "learning_rate": 4.510243262493903e-06,
      "loss": 0.133,
      "mae_dtheta": 0.012811953201889992,
      "mae_dx": 0.0028266129083931446,
      "mae_dy": 0.003973019775003195,
      "pose_mae_dtheta": 0.09111578017473221,
      "pose_mae_dx": 0.034946706146001816,
      "pose_mae_dy": 0.03801164776086807,
      "pose_rmse_dtheta": 0.19245877861976624,
      "pose_rmse_dx": 0.11048455536365509,
      "pose_rmse_dy": 0.08339425176382065,
      "pose_rmse_mean": 0.12877920269966125,
      "rmse_dtheta": 0.02390177734196186,
      "rmse_dx": 0.008958972990512848,
      "rmse_dy": 0.008296867832541466,
      "rmse_mean": 0.013719206675887108,
      "rotation_flip": 0.005058488808572292,
      "sparse_tokens": 32089.0,
      "step": 6432,
      "turn_loss": 0.11888976395130157,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.2988756736666047,
      "grad_norm": 0.7226212024688721,
      "learning_rate": 4.5089274187848144e-06,
      "loss": 0.1622,
      "mae_dtheta": 0.02807730995118618,
      "mae_dx": 0.007431482896208763,
      "mae_dy": 0.00381996831856668,
      "pose_mae_dtheta": 0.22601476311683655,
      "pose_mae_dx": 0.05982556194067001,
      "pose_mae_dy": 0.051526427268981934,
      "pose_rmse_dtheta": 0.4117378890514374,
      "pose_rmse_dx": 0.16290798783302307,
      "pose_rmse_dy": 0.15760603547096252,
      "pose_rmse_mean": 0.244083970785141,
      "rmse_dtheta": 0.046016767621040344,
      "rmse_dx": 0.01846640184521675,
      "rmse_dy": 0.008346167393028736,
      "rmse_mean": 0.02427644655108452,
      "rotation_flip": 0.006178287789225578,
      "sparse_tokens": 21322.0,
      "step": 6433,
      "turn_loss": 0.21642164885997772,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2989221334324475,
      "grad_norm": 0.4785269796848297,
      "learning_rate": 4.507611609416695e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.008713224902749062,
      "mae_dx": 0.0013310844078660011,
      "mae_dy": 0.0019528656266629696,
      "pose_mae_dtheta": 0.06001850217580795,
      "pose_mae_dx": 0.02100294455885887,
      "pose_mae_dy": 0.023394480347633362,
      "pose_rmse_dtheta": 0.19104580581188202,
      "pose_rmse_dx": 0.052929218858480453,
      "pose_rmse_dy": 0.054104581475257874,
      "pose_rmse_mean": 0.09935986995697021,
      "rmse_dtheta": 0.023271149024367332,
      "rmse_dx": 0.0037653991021215916,
      "rmse_dy": 0.004328778479248285,
      "rmse_mean": 0.010455109179019928,
      "rotation_flip": 0.0008695652359165251,
      "sparse_tokens": 32089.0,
      "step": 6434,
      "turn_loss": 0.06487046182155609,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2989685931982903,
      "grad_norm": 0.4326556921005249,
      "learning_rate": 4.506295834481561e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.010986422188580036,
      "mae_dx": 0.002043485641479492,
      "mae_dy": 0.003055333159863949,
      "pose_mae_dtheta": 0.07517706602811813,
      "pose_mae_dx": 0.02805187553167343,
      "pose_mae_dy": 0.03635965660214424,
      "pose_rmse_dtheta": 0.16814006865024567,
      "pose_rmse_dx": 0.07379917055368423,
      "pose_rmse_dy": 0.09256882965564728,
      "pose_rmse_mean": 0.11150269210338593,
      "rmse_dtheta": 0.022059224545955658,
      "rmse_dx": 0.0060355402529239655,
      "rmse_dy": 0.007090040482580662,
      "rmse_mean": 0.01172826811671257,
      "rotation_flip": 0.005997600965201855,
      "sparse_tokens": 32089.0,
      "step": 6435,
      "turn_loss": 0.09075211733579636,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.29901505296413305,
      "grad_norm": 0.4995056390762329,
      "learning_rate": 4.504980094071424e-06,
      "loss": 0.0756,
      "mae_dtheta": 0.008166324347257614,
      "mae_dx": 0.0012181189376860857,
      "mae_dy": 0.001639357302337885,
      "pose_mae_dtheta": 0.053319841623306274,
      "pose_mae_dx": 0.01457996480166912,
      "pose_mae_dy": 0.01669641025364399,
      "pose_rmse_dtheta": 0.18382546305656433,
      "pose_rmse_dx": 0.043646637350320816,
      "pose_rmse_dy": 0.04772154614329338,
      "pose_rmse_mean": 0.09173121303319931,
      "rmse_dtheta": 0.022297382354736328,
      "rmse_dx": 0.004099339246749878,
      "rmse_dy": 0.00390641950070858,
      "rmse_mean": 0.010101047344505787,
      "rotation_flip": 0.011548556387424469,
      "sparse_tokens": 32073.0,
      "step": 6436,
      "turn_loss": 0.05786129832267761,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.29906151272997583,
      "grad_norm": 0.3932771384716034,
      "learning_rate": 4.503664388278296e-06,
      "loss": 0.1093,
      "mae_dtheta": 0.028209183365106583,
      "mae_dx": 0.010885410010814667,
      "mae_dy": 0.004891143646091223,
      "pose_mae_dtheta": 0.20919126272201538,
      "pose_mae_dx": 0.07833138108253479,
      "pose_mae_dy": 0.0560886450111866,
      "pose_rmse_dtheta": 0.39569181203842163,
      "pose_rmse_dx": 0.18101660907268524,
      "pose_rmse_dy": 0.13394668698310852,
      "pose_rmse_mean": 0.23688504099845886,
      "rmse_dtheta": 0.04513823613524437,
      "rmse_dx": 0.023064706474542618,
      "rmse_dy": 0.010250573046505451,
      "rmse_mean": 0.026151172816753387,
      "rotation_flip": 0.017364658415317535,
      "sparse_tokens": 19480.0,
      "step": 6437,
      "turn_loss": 0.24364657700061798,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 32662.0,
      "epoch": 0.2991079724958186,
      "grad_norm": 0.6028952598571777,
      "learning_rate": 4.50234871719418e-06,
      "loss": 0.1523,
      "mae_dtheta": 0.04042057693004608,
      "mae_dx": 0.01234920509159565,
      "mae_dy": 0.0050993263721466064,
      "pose_mae_dtheta": 0.3238351047039032,
      "pose_mae_dx": 0.1118338331580162,
      "pose_mae_dy": 0.05950762704014778,
      "pose_rmse_dtheta": 0.5700997114181519,
      "pose_rmse_dx": 0.22400930523872375,
      "pose_rmse_dy": 0.1291952133178711,
      "pose_rmse_mean": 0.3077680766582489,
      "rmse_dtheta": 0.05993111804127693,
      "rmse_dx": 0.02394404448568821,
      "rmse_dy": 0.009637150913476944,
      "rmse_mean": 0.031170770525932312,
      "rotation_flip": 0.016436554491519928,
      "sparse_tokens": 24815.0,
      "step": 6438,
      "turn_loss": 0.24566861987113953,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 24340.0,
      "epoch": 0.2991544322616614,
      "grad_norm": 0.7091774344444275,
      "learning_rate": 4.501033080911087e-06,
      "loss": 0.1608,
      "mae_dtheta": 0.0284042377024889,
      "mae_dx": 0.013798111118376255,
      "mae_dy": 0.0032509444281458855,
      "pose_mae_dtheta": 0.21988172829151154,
      "pose_mae_dx": 0.10746787488460541,
      "pose_mae_dy": 0.04336986318230629,
      "pose_rmse_dtheta": 0.4264039695262909,
      "pose_rmse_dx": 0.24221862852573395,
      "pose_rmse_dy": 0.11456147581338882,
      "pose_rmse_mean": 0.2610613703727722,
      "rmse_dtheta": 0.045187510550022125,
      "rmse_dx": 0.027686841785907745,
      "rmse_dy": 0.006406628526747227,
      "rmse_mean": 0.026426993310451508,
      "rotation_flip": 0.010968921706080437,
      "sparse_tokens": 19975.0,
      "step": 6439,
      "turn_loss": 0.23341786861419678,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.29920089202750416,
      "grad_norm": 0.5825814604759216,
      "learning_rate": 4.49971747952102e-06,
      "loss": 0.1133,
      "mae_dtheta": 0.030918104574084282,
      "mae_dx": 0.012987173162400723,
      "mae_dy": 0.004095335025340319,
      "pose_mae_dtheta": 0.24747775495052338,
      "pose_mae_dx": 0.11407306045293808,
      "pose_mae_dy": 0.05727452039718628,
      "pose_rmse_dtheta": 0.4257779121398926,
      "pose_rmse_dx": 0.25204429030418396,
      "pose_rmse_dy": 0.1281745284795761,
      "pose_rmse_mean": 0.268665611743927,
      "rmse_dtheta": 0.04787976294755936,
      "rmse_dx": 0.025201965123414993,
      "rmse_dy": 0.00793515332043171,
      "rmse_mean": 0.027005627751350403,
      "rotation_flip": 0.010683760978281498,
      "sparse_tokens": 9160.0,
      "step": 6440,
      "turn_loss": 0.2358674705028534,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.29924735179334694,
      "grad_norm": 0.4758455157279968,
      "learning_rate": 4.498401913115975e-06,
      "loss": 0.1006,
      "mae_dtheta": 0.0317944772541523,
      "mae_dx": 0.010925103910267353,
      "mae_dy": 0.004574169404804707,
      "pose_mae_dtheta": 0.22722992300987244,
      "pose_mae_dx": 0.08394678682088852,
      "pose_mae_dy": 0.06709147989749908,
      "pose_rmse_dtheta": 0.40060749650001526,
      "pose_rmse_dx": 0.18734295666217804,
      "pose_rmse_dy": 0.1401674598455429,
      "pose_rmse_mean": 0.24270598590373993,
      "rmse_dtheta": 0.04998080059885979,
      "rmse_dx": 0.022507330402731895,
      "rmse_dy": 0.008392528630793095,
      "rmse_mean": 0.02696022018790245,
      "rotation_flip": 0.0199115052819252,
      "sparse_tokens": 8239.0,
      "step": 6441,
      "turn_loss": 0.2128036618232727,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 21359.0,
      "epoch": 0.2992938115591897,
      "grad_norm": 0.4745784103870392,
      "learning_rate": 4.497086381787958e-06,
      "loss": 0.0923,
      "mae_dtheta": 0.04156673327088356,
      "mae_dx": 0.01218677032738924,
      "mae_dy": 0.0038703358732163906,
      "pose_mae_dtheta": 0.37828826904296875,
      "pose_mae_dx": 0.09979680180549622,
      "pose_mae_dy": 0.04955851659178734,
      "pose_rmse_dtheta": 0.6285156011581421,
      "pose_rmse_dx": 0.21052131056785583,
      "pose_rmse_dy": 0.1321725994348526,
      "pose_rmse_mean": 0.3237365186214447,
      "rmse_dtheta": 0.06050129607319832,
      "rmse_dx": 0.023982567712664604,
      "rmse_dy": 0.007605936378240585,
      "rmse_mean": 0.030696600675582886,
      "rotation_flip": 0.007568590342998505,
      "sparse_tokens": 18198.0,
      "step": 6442,
      "turn_loss": 0.26268184185028076,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.29934027132503255,
      "grad_norm": 0.7031451463699341,
      "learning_rate": 4.495770885628955e-06,
      "loss": 0.1471,
      "mae_dtheta": 0.03106667660176754,
      "mae_dx": 0.00907775480300188,
      "mae_dy": 0.004464510828256607,
      "pose_mae_dtheta": 0.2321857511997223,
      "pose_mae_dx": 0.04861657693982124,
      "pose_mae_dy": 0.07018855214118958,
      "pose_rmse_dtheta": 0.46331891417503357,
      "pose_rmse_dx": 0.11415737867355347,
      "pose_rmse_dy": 0.18553069233894348,
      "pose_rmse_mean": 0.2543356418609619,
      "rmse_dtheta": 0.05142752453684807,
      "rmse_dx": 0.02075432799756527,
      "rmse_dy": 0.010141448117792606,
      "rmse_mean": 0.027441099286079407,
      "rotation_flip": 0.009900989942252636,
      "sparse_tokens": 9139.0,
      "step": 6443,
      "turn_loss": 0.3250501751899719,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.2993867310908753,
      "grad_norm": 0.7256341576576233,
      "learning_rate": 4.4944554247309666e-06,
      "loss": 0.149,
      "mae_dtheta": 0.026107005774974823,
      "mae_dx": 0.011216706596314907,
      "mae_dy": 0.0035122253466397524,
      "pose_mae_dtheta": 0.1879301220178604,
      "pose_mae_dx": 0.09025298804044724,
      "pose_mae_dy": 0.03927662596106529,
      "pose_rmse_dtheta": 0.3217952847480774,
      "pose_rmse_dx": 0.19541630148887634,
      "pose_rmse_dy": 0.0873260572552681,
      "pose_rmse_mean": 0.20151254534721375,
      "rmse_dtheta": 0.040570978075265884,
      "rmse_dx": 0.022191500291228294,
      "rmse_dy": 0.007876815274357796,
      "rmse_mean": 0.023546431213617325,
      "rotation_flip": 0.015449438244104385,
      "sparse_tokens": 11759.0,
      "step": 6444,
      "turn_loss": 0.20805837213993073,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.2994331908567181,
      "grad_norm": 0.7291375398635864,
      "learning_rate": 4.493139999185984e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.03144882619380951,
      "mae_dx": 0.011134215630590916,
      "mae_dy": 0.006319074425846338,
      "pose_mae_dtheta": 0.2403048276901245,
      "pose_mae_dx": 0.10928212851285934,
      "pose_mae_dy": 0.06160428375005722,
      "pose_rmse_dtheta": 0.3929802179336548,
      "pose_rmse_dx": 0.2261427640914917,
      "pose_rmse_dy": 0.1802452653646469,
      "pose_rmse_mean": 0.26645609736442566,
      "rmse_dtheta": 0.05067767575383186,
      "rmse_dx": 0.02258068509399891,
      "rmse_dy": 0.017143145203590393,
      "rmse_mean": 0.030133835971355438,
      "rotation_flip": 0.009259259328246117,
      "sparse_tokens": 7060.0,
      "step": 6445,
      "turn_loss": 0.31754159927368164,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.2994796506225609,
      "grad_norm": 0.4809521734714508,
      "learning_rate": 4.4918246090859905e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.006991831120103598,
      "mae_dx": 0.0011808593990281224,
      "mae_dy": 0.0015371537301689386,
      "pose_mae_dtheta": 0.049190450459718704,
      "pose_mae_dx": 0.01776745170354843,
      "pose_mae_dy": 0.020978018641471863,
      "pose_rmse_dtheta": 0.13701516389846802,
      "pose_rmse_dx": 0.05129208415746689,
      "pose_rmse_dy": 0.06736423820257187,
      "pose_rmse_mean": 0.08522383868694305,
      "rmse_dtheta": 0.018576091155409813,
      "rmse_dx": 0.0035896357148885727,
      "rmse_dy": 0.003951421473175287,
      "rmse_mean": 0.008705716580152512,
      "rotation_flip": 0.0004889975534752011,
      "sparse_tokens": 32089.0,
      "step": 6446,
      "turn_loss": 0.059721291065216064,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.29952611038840365,
      "grad_norm": 1.3474690914154053,
      "learning_rate": 4.490509254522977e-06,
      "loss": 0.2955,
      "mae_dtheta": 0.030497686937451363,
      "mae_dx": 0.017210766673088074,
      "mae_dy": 0.0058572362177073956,
      "pose_mae_dtheta": 0.24172455072402954,
      "pose_mae_dx": 0.1441650241613388,
      "pose_mae_dy": 0.07202243059873581,
      "pose_rmse_dtheta": 0.423790842294693,
      "pose_rmse_dx": 0.30115288496017456,
      "pose_rmse_dy": 0.12968112528324127,
      "pose_rmse_mean": 0.28487497568130493,
      "rmse_dtheta": 0.04609769955277443,
      "rmse_dx": 0.031638436019420624,
      "rmse_dy": 0.00983119010925293,
      "rmse_mean": 0.029189109802246094,
      "rotation_flip": 0.013317191042006016,
      "sparse_tokens": 16295.0,
      "step": 6447,
      "turn_loss": 0.3171440660953522,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 30173.0,
      "epoch": 0.29957257015424643,
      "grad_norm": 0.4384835958480835,
      "learning_rate": 4.489193935588923e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.040059104561805725,
      "mae_dx": 0.00933888927102089,
      "mae_dy": 0.005897211376577616,
      "pose_mae_dtheta": 0.3143969476222992,
      "pose_mae_dx": 0.0769825130701065,
      "pose_mae_dy": 0.05244141444563866,
      "pose_rmse_dtheta": 0.5515536665916443,
      "pose_rmse_dx": 0.17914073169231415,
      "pose_rmse_dy": 0.16196584701538086,
      "pose_rmse_mean": 0.2975534200668335,
      "rmse_dtheta": 0.05930056795477867,
      "rmse_dx": 0.019543379545211792,
      "rmse_dy": 0.014753426425158978,
      "rmse_mean": 0.031199125573039055,
      "rotation_flip": 0.007323568686842918,
      "sparse_tokens": 23315.0,
      "step": 6448,
      "turn_loss": 0.29024338722229004,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.2996190299200892,
      "grad_norm": 0.8907173275947571,
      "learning_rate": 4.487878652375813e-06,
      "loss": 0.2328,
      "mae_dtheta": 0.022653013467788696,
      "mae_dx": 0.006726414896547794,
      "mae_dy": 0.0035488205030560493,
      "pose_mae_dtheta": 0.15034526586532593,
      "pose_mae_dx": 0.04664643853902817,
      "pose_mae_dy": 0.03720705956220627,
      "pose_rmse_dtheta": 0.2698025405406952,
      "pose_rmse_dx": 0.1202995628118515,
      "pose_rmse_dy": 0.08204590529203415,
      "pose_rmse_mean": 0.15738266706466675,
      "rmse_dtheta": 0.035409677773714066,
      "rmse_dx": 0.016569461673498154,
      "rmse_dy": 0.006264953874051571,
      "rmse_mean": 0.01941469870507717,
      "rotation_flip": 0.007853402756154537,
      "sparse_tokens": 6824.0,
      "step": 6449,
      "turn_loss": 0.21621491014957428,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.299665489685932,
      "grad_norm": 0.44395655393600464,
      "learning_rate": 4.486563404975622e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.006803686730563641,
      "mae_dx": 0.0015828970354050398,
      "mae_dy": 0.0010758464923128486,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44395655393600464,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 175.9724578857422,
      "model/head/act_norm_mean": 135.5760830965909,
      "model/head/act_norm_min": 63.51045608520508,
      "model/head/act_over_embed": 93.1691535872651,
      "model/head/grad_frac": 0.10952360183000565,
      "model/head/grad_norm": 0.04862372204661369,
      "model/head/grad_zero_frac": 0.00018211398855783045,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6959043560606061,
      "model/head/update_ratio": 0.0008300482295453548,
      "model/head/weight_delta": 9.155024528503418,
      "model/head/weight_delta_rel": 0.160606250166893,
      "model/head/weight_norm": 58.57939529418945,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42140692472457886,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42132675910311124,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4212433695793152,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28953969337892377,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08552228659391403,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03796818107366562,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5514781800660793,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001226837164722383,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9570577144622803,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09661629050970078,
      "model/modality_embedder.encoders.pose/weight_norm": 30.94801902770996,
      "model/modality_embedder/grad_frac": 0.08552228659391403,
      "model/modality_embedder/grad_norm": 0.03796818107366562,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5514781800660793,
      "model/modality_embedder/update_ratio": 0.001226837164722383,
      "model/modality_embedder/weight_delta": 2.9570577144622803,
      "model/modality_embedder/weight_delta_rel": 0.09661629050970078,
      "model/modality_embedder/weight_norm": 30.94801902770996,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 99.2294921875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 26.113789181497516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.06291675567627,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.945640406671274,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10152143239974976,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.045071106404066086,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016166700515896082,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.366422653198242,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08623386919498444,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.878976821899414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 100.29625701904297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 27.16592011383678,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.278305053710938,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.668674633579798,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09493003040552139,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.042144808918237686,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014220800949260592,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 2.9995596408843994,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10390709340572357,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.636030197143555,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 101.75762176513672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.986454324995993,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.127532958984375,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.919762787598227,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08923494070768356,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03961643576622009,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012947618961334229,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.234661102294922,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10861386358737946,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.59746742248535,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 102.53520965576172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 30.64308762225429,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.908979415893555,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 21.058216699119416,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10148467868566513,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04505478963255882,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015095622511580586,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.766364097595215,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09454119950532913,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.846261978149414,
      "model/normalizer/grad_frac": 0.37595945596694946,
      "model/normalizer/grad_norm": 0.16690966486930847,
      "model/normalizer/grad_zero_frac": 0.00018907814228441566,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021260709036141634,
      "model/normalizer/weight_delta": 5.852698802947998,
      "model/normalizer/weight_delta_rel": 0.0753793716430664,
      "model/normalizer/weight_norm": 78.50616455078125,
      "pose_mae_dtheta": 0.052062127739191055,
      "pose_mae_dx": 0.01442673522979021,
      "pose_mae_dy": 0.014644133858382702,
      "pose_rmse_dtheta": 0.20516079664230347,
      "pose_rmse_dx": 0.03825107961893082,
      "pose_rmse_dy": 0.08662870526313782,
      "pose_rmse_mean": 0.11001352965831757,
      "rmse_dtheta": 0.023556500673294067,
      "rmse_dx": 0.004997818730771542,
      "rmse_dy": 0.004906033631414175,
      "rmse_mean": 0.011153451167047024,
      "rotation_flip": 0.0019181586103513837,
      "sparse_tokens": 32137.0,
      "step": 6450,
      "turn_loss": 0.05800875648856163,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.29971194945177476,
      "grad_norm": 0.610888659954071,
      "learning_rate": 4.485248193480328e-06,
      "loss": 0.128,
      "mae_dtheta": 0.034612987190485,
      "mae_dx": 0.008532670326530933,
      "mae_dy": 0.0036874401848763227,
      "pose_mae_dtheta": 0.31688517332077026,
      "pose_mae_dx": 0.061669886112213135,
      "pose_mae_dy": 0.037446457892656326,
      "pose_rmse_dtheta": 0.5798501372337341,
      "pose_rmse_dx": 0.16970287263393402,
      "pose_rmse_dy": 0.09473550319671631,
      "pose_rmse_mean": 0.2814295291900635,
      "rmse_dtheta": 0.055293742567300797,
      "rmse_dx": 0.02014220505952835,
      "rmse_dy": 0.008133676834404469,
      "rmse_mean": 0.02785654366016388,
      "rotation_flip": 0.012077294290065765,
      "sparse_tokens": 6654.0,
      "step": 6451,
      "turn_loss": 0.22464382648468018,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.29975840921761754,
      "grad_norm": 0.6730901002883911,
      "learning_rate": 4.483933017981905e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.030740370973944664,
      "mae_dx": 0.012749656103551388,
      "mae_dy": 0.006710169371217489,
      "pose_mae_dtheta": 0.23534277081489563,
      "pose_mae_dx": 0.10082314908504486,
      "pose_mae_dy": 0.08048618584871292,
      "pose_rmse_dtheta": 0.4246908128261566,
      "pose_rmse_dx": 0.2261064052581787,
      "pose_rmse_dy": 0.2005491703748703,
      "pose_rmse_mean": 0.28378215432167053,
      "rmse_dtheta": 0.04732329770922661,
      "rmse_dx": 0.025442006066441536,
      "rmse_dy": 0.013992841355502605,
      "rmse_mean": 0.028919382020831108,
      "rotation_flip": 0.01708766631782055,
      "sparse_tokens": 23186.0,
      "step": 6452,
      "turn_loss": 0.26182645559310913,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.2998048689834603,
      "grad_norm": 0.43378835916519165,
      "learning_rate": 4.482617878572322e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.030781062319874763,
      "mae_dx": 0.005000211298465729,
      "mae_dy": 0.0039580403827130795,
      "pose_mae_dtheta": 0.25827136635780334,
      "pose_mae_dx": 0.02586410939693451,
      "pose_mae_dy": 0.05481250584125519,
      "pose_rmse_dtheta": 0.5361627340316772,
      "pose_rmse_dx": 0.0626392662525177,
      "pose_rmse_dy": 0.20047692954540253,
      "pose_rmse_mean": 0.26642632484436035,
      "rmse_dtheta": 0.05457180365920067,
      "rmse_dx": 0.011732187122106552,
      "rmse_dy": 0.01088117714971304,
      "rmse_mean": 0.025728389620780945,
      "rotation_flip": 0.011627906933426857,
      "sparse_tokens": 3314.0,
      "step": 6453,
      "turn_loss": 0.13243700563907623,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.2998513287493031,
      "grad_norm": 0.3548930883407593,
      "learning_rate": 4.481302775343551e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.00990834180265665,
      "mae_dx": 0.0014136271784082055,
      "mae_dy": 0.0022091043647378683,
      "pose_mae_dtheta": 0.06584683060646057,
      "pose_mae_dx": 0.024649985134601593,
      "pose_mae_dy": 0.028762681409716606,
      "pose_rmse_dtheta": 0.17553766071796417,
      "pose_rmse_dx": 0.06509077548980713,
      "pose_rmse_dy": 0.07014981657266617,
      "pose_rmse_mean": 0.10359275341033936,
      "rmse_dtheta": 0.022573914378881454,
      "rmse_dx": 0.0045652794651687145,
      "rmse_dy": 0.004850623197853565,
      "rmse_mean": 0.010663272812962532,
      "rotation_flip": 0.0037894737906754017,
      "sparse_tokens": 32041.0,
      "step": 6454,
      "turn_loss": 0.08473139256238937,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.29989778851514587,
      "grad_norm": 0.2934072017669678,
      "learning_rate": 4.479987708387552e-06,
      "loss": 0.0657,
      "mae_dtheta": 0.008862527087330818,
      "mae_dx": 0.0014841932570561767,
      "mae_dy": 0.0021731832530349493,
      "pose_mae_dtheta": 0.06420034170150757,
      "pose_mae_dx": 0.023482000455260277,
      "pose_mae_dy": 0.027961643412709236,
      "pose_rmse_dtheta": 0.1615740805864334,
      "pose_rmse_dx": 0.0656486228108406,
      "pose_rmse_dy": 0.07041613757610321,
      "pose_rmse_mean": 0.09921294450759888,
      "rmse_dtheta": 0.019811388105154037,
      "rmse_dx": 0.004847981501370668,
      "rmse_dy": 0.004950254689902067,
      "rmse_mean": 0.009869875386357307,
      "rotation_flip": 0.00207125092856586,
      "sparse_tokens": 32089.0,
      "step": 6455,
      "turn_loss": 0.07859352231025696,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.29994424828098865,
      "grad_norm": 0.45158541202545166,
      "learning_rate": 4.478672677796294e-06,
      "loss": 0.0935,
      "mae_dtheta": 0.029040031135082245,
      "mae_dx": 0.00899986457079649,
      "mae_dy": 0.005223406013101339,
      "pose_mae_dtheta": 0.22130800783634186,
      "pose_mae_dx": 0.07112088799476624,
      "pose_mae_dy": 0.057165224105119705,
      "pose_rmse_dtheta": 0.412046879529953,
      "pose_rmse_dx": 0.1799778938293457,
      "pose_rmse_dy": 0.12702590227127075,
      "pose_rmse_mean": 0.23968356847763062,
      "rmse_dtheta": 0.047851886600255966,
      "rmse_dx": 0.02079240418970585,
      "rmse_dy": 0.011032052338123322,
      "rmse_mean": 0.026558782905340195,
      "rotation_flip": 0.010700388811528683,
      "sparse_tokens": 18970.0,
      "step": 6456,
      "turn_loss": 0.22446706891059875,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.2999907080468314,
      "grad_norm": 0.45788800716400146,
      "learning_rate": 4.477357683661734e-06,
      "loss": 0.0869,
      "mae_dtheta": 0.0066175502724945545,
      "mae_dx": 0.0016886632656678557,
      "mae_dy": 0.000899846141692251,
      "pose_mae_dtheta": 0.047547731548547745,
      "pose_mae_dx": 0.015147149562835693,
      "pose_mae_dy": 0.010602492839097977,
      "pose_rmse_dtheta": 0.180178701877594,
      "pose_rmse_dx": 0.04779557138681412,
      "pose_rmse_dy": 0.035223063081502914,
      "pose_rmse_mean": 0.08773244917392731,
      "rmse_dtheta": 0.021393869072198868,
      "rmse_dx": 0.006155695300549269,
      "rmse_dy": 0.0031857211142778397,
      "rmse_mean": 0.010245095938444138,
      "rotation_flip": 0.002785515272989869,
      "sparse_tokens": 32105.0,
      "step": 6457,
      "turn_loss": 0.055903028696775436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3000371678126742,
      "grad_norm": 0.5492181181907654,
      "learning_rate": 4.476042726075831e-06,
      "loss": 0.1462,
      "mae_dtheta": 0.016721954569220543,
      "mae_dx": 0.002502745483070612,
      "mae_dy": 0.005273912567645311,
      "pose_mae_dtheta": 0.10961437970399857,
      "pose_mae_dx": 0.03825236111879349,
      "pose_mae_dy": 0.05554845556616783,
      "pose_rmse_dtheta": 0.21707633137702942,
      "pose_rmse_dx": 0.08356311172246933,
      "pose_rmse_dy": 0.15110668540000916,
      "pose_rmse_mean": 0.15058204531669617,
      "rmse_dtheta": 0.028986064717173576,
      "rmse_dx": 0.006679947953671217,
      "rmse_dy": 0.011460869573056698,
      "rmse_mean": 0.015708960592746735,
      "rotation_flip": 0.005017246585339308,
      "sparse_tokens": 32073.0,
      "step": 6458,
      "turn_loss": 0.1465815007686615,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.30008362757851703,
      "grad_norm": 0.5023587346076965,
      "learning_rate": 4.4747278051305435e-06,
      "loss": 0.0745,
      "mae_dtheta": 0.008113758638501167,
      "mae_dx": 0.0017296147998422384,
      "mae_dy": 0.0012577028246596456,
      "pose_mae_dtheta": 0.05650249496102333,
      "pose_mae_dx": 0.01673310250043869,
      "pose_mae_dy": 0.01334929745644331,
      "pose_rmse_dtheta": 0.1902884840965271,
      "pose_rmse_dx": 0.038091886788606644,
      "pose_rmse_dy": 0.03464137762784958,
      "pose_rmse_mean": 0.08767391741275787,
      "rmse_dtheta": 0.02334735170006752,
      "rmse_dx": 0.004631943069398403,
      "rmse_dy": 0.003185693407431245,
      "rmse_mean": 0.0103883296251297,
      "rotation_flip": 0.001276595750823617,
      "sparse_tokens": 32233.0,
      "step": 6459,
      "turn_loss": 0.06905559450387955,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.3001300873443598,
      "grad_norm": 0.6616143584251404,
      "learning_rate": 4.473412920917821e-06,
      "loss": 0.1024,
      "mae_dtheta": 0.029657911509275436,
      "mae_dx": 0.007453824859112501,
      "mae_dy": 0.004005413502454758,
      "pose_mae_dtheta": 0.22882650792598724,
      "pose_mae_dx": 0.06269475072622299,
      "pose_mae_dy": 0.04691804572939873,
      "pose_rmse_dtheta": 0.4734547734260559,
      "pose_rmse_dx": 0.16024960577487946,
      "pose_rmse_dy": 0.09757965803146362,
      "pose_rmse_mean": 0.243761345744133,
      "rmse_dtheta": 0.04937368631362915,
      "rmse_dx": 0.017569581046700478,
      "rmse_dy": 0.009437653236091137,
      "rmse_mean": 0.02546030655503273,
      "rotation_flip": 0.01123595517128706,
      "sparse_tokens": 12989.0,
      "step": 6460,
      "turn_loss": 0.21694831550121307,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.3001765471102026,
      "grad_norm": 0.6667962074279785,
      "learning_rate": 4.472098073529617e-06,
      "loss": 0.1605,
      "mae_dtheta": 0.02870026044547558,
      "mae_dx": 0.013825750909745693,
      "mae_dy": 0.0027011961210519075,
      "pose_mae_dtheta": 0.22722861170768738,
      "pose_mae_dx": 0.11184860020875931,
      "pose_mae_dy": 0.03463079407811165,
      "pose_rmse_dtheta": 0.3877516984939575,
      "pose_rmse_dx": 0.27001747488975525,
      "pose_rmse_dy": 0.08321661502122879,
      "pose_rmse_mean": 0.24699527025222778,
      "rmse_dtheta": 0.043876804411411285,
      "rmse_dx": 0.027403121814131737,
      "rmse_dy": 0.005421153269708157,
      "rmse_mean": 0.025567028671503067,
      "rotation_flip": 0.014970059506595135,
      "sparse_tokens": 7125.0,
      "step": 6461,
      "turn_loss": 0.21527409553527832,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.30022300687604536,
      "grad_norm": 0.4322637915611267,
      "learning_rate": 4.4707832630578765e-06,
      "loss": 0.1139,
      "mae_dtheta": 0.011272107250988483,
      "mae_dx": 0.0018324466655030847,
      "mae_dy": 0.0019154538167640567,
      "pose_mae_dtheta": 0.0776888057589531,
      "pose_mae_dx": 0.019534578546881676,
      "pose_mae_dy": 0.020338572561740875,
      "pose_rmse_dtheta": 0.22186480462551117,
      "pose_rmse_dx": 0.04931690916419029,
      "pose_rmse_dy": 0.05083213746547699,
      "pose_rmse_mean": 0.10733795166015625,
      "rmse_dtheta": 0.027971820905804634,
      "rmse_dx": 0.005982558708637953,
      "rmse_dy": 0.006143581587821245,
      "rmse_mean": 0.01336598675698042,
      "rotation_flip": 0.0029296875,
      "sparse_tokens": 32105.0,
      "step": 6462,
      "turn_loss": 0.07793395966291428,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30819.0,
      "epoch": 0.30026946664188814,
      "grad_norm": 0.40278080105781555,
      "learning_rate": 4.469468489594546e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.025166288018226624,
      "mae_dx": 0.009573209099471569,
      "mae_dy": 0.004480219911783934,
      "pose_mae_dtheta": 0.19060830771923065,
      "pose_mae_dx": 0.08006947487592697,
      "pose_mae_dy": 0.05389539524912834,
      "pose_rmse_dtheta": 0.3421262502670288,
      "pose_rmse_dx": 0.21346992254257202,
      "pose_rmse_dy": 0.12934723496437073,
      "pose_rmse_mean": 0.22831448912620544,
      "rmse_dtheta": 0.04198914393782616,
      "rmse_dx": 0.02242799662053585,
      "rmse_dy": 0.01034949254244566,
      "rmse_mean": 0.024922210723161697,
      "rotation_flip": 0.017617449164390564,
      "sparse_tokens": 24165.0,
      "step": 6463,
      "turn_loss": 0.1995474100112915,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.3003159264077309,
      "grad_norm": 0.6141467094421387,
      "learning_rate": 4.468153753231571e-06,
      "loss": 0.1954,
      "mae_dtheta": 0.020545348525047302,
      "mae_dx": 0.005876718554645777,
      "mae_dy": 0.003115269122645259,
      "pose_mae_dtheta": 0.16298924386501312,
      "pose_mae_dx": 0.04975074157118797,
      "pose_mae_dy": 0.05317780002951622,
      "pose_rmse_dtheta": 0.3320412039756775,
      "pose_rmse_dx": 0.15732915699481964,
      "pose_rmse_dy": 0.13105544447898865,
      "pose_rmse_mean": 0.20680861175060272,
      "rmse_dtheta": 0.036705195903778076,
      "rmse_dx": 0.015865739434957504,
      "rmse_dy": 0.007614750415086746,
      "rmse_mean": 0.02006189525127411,
      "rotation_flip": 0.006973500829190016,
      "sparse_tokens": 17950.0,
      "step": 6464,
      "turn_loss": 0.11430875957012177,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3003623861735737,
      "grad_norm": 0.6869879364967346,
      "learning_rate": 4.466839054060888e-06,
      "loss": 0.0855,
      "mae_dtheta": 0.014908308163285255,
      "mae_dx": 0.0027613076381385326,
      "mae_dy": 0.003999398555606604,
      "pose_mae_dtheta": 0.11121153086423874,
      "pose_mae_dx": 0.03579220548272133,
      "pose_mae_dy": 0.03849073126912117,
      "pose_rmse_dtheta": 0.26250967383384705,
      "pose_rmse_dx": 0.08704551309347153,
      "pose_rmse_dy": 0.08389955013990402,
      "pose_rmse_mean": 0.14448492228984833,
      "rmse_dtheta": 0.02998158149421215,
      "rmse_dx": 0.00790350791066885,
      "rmse_dy": 0.010207759216427803,
      "rmse_mean": 0.016030950471758842,
      "rotation_flip": 0.010141988284885883,
      "sparse_tokens": 32089.0,
      "step": 6465,
      "turn_loss": 0.1280747354030609,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.30040884593941647,
      "grad_norm": 0.6252456903457642,
      "learning_rate": 4.465524392174437e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.032985467463731766,
      "mae_dx": 0.010797513648867607,
      "mae_dy": 0.003933405503630638,
      "pose_mae_dtheta": 0.2403159737586975,
      "pose_mae_dx": 0.07750725001096725,
      "pose_mae_dy": 0.031713396310806274,
      "pose_rmse_dtheta": 0.45359379053115845,
      "pose_rmse_dx": 0.19440865516662598,
      "pose_rmse_dy": 0.08285624533891678,
      "pose_rmse_mean": 0.24361956119537354,
      "rmse_dtheta": 0.05197303369641304,
      "rmse_dx": 0.02302621118724346,
      "rmse_dy": 0.00846878346055746,
      "rmse_mean": 0.027822677046060562,
      "rotation_flip": 0.012578615918755531,
      "sparse_tokens": 18060.0,
      "step": 6466,
      "turn_loss": 0.24611207842826843,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.30045530570525925,
      "grad_norm": 0.7672887444496155,
      "learning_rate": 4.464209767664151e-06,
      "loss": 0.1471,
      "mae_dtheta": 0.02899600751698017,
      "mae_dx": 0.013205661438405514,
      "mae_dy": 0.004050634801387787,
      "pose_mae_dtheta": 0.2196105569601059,
      "pose_mae_dx": 0.11012665927410126,
      "pose_mae_dy": 0.06269806623458862,
      "pose_rmse_dtheta": 0.37662458419799805,
      "pose_rmse_dx": 0.23400811851024628,
      "pose_rmse_dy": 0.149635449051857,
      "pose_rmse_mean": 0.25342273712158203,
      "rmse_dtheta": 0.04464131221175194,
      "rmse_dx": 0.02621716447174549,
      "rmse_dy": 0.007836056873202324,
      "rmse_mean": 0.026231512427330017,
      "rotation_flip": 0.008130080997943878,
      "sparse_tokens": 18467.0,
      "step": 6467,
      "turn_loss": 0.2298346310853958,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.300501765471102,
      "grad_norm": 0.7168664336204529,
      "learning_rate": 4.462895180621965e-06,
      "loss": 0.1535,
      "mae_dtheta": 0.04312898591160774,
      "mae_dx": 0.018217135220766068,
      "mae_dy": 0.020414059981703758,
      "pose_mae_dtheta": 0.2971150875091553,
      "pose_mae_dx": 0.15421009063720703,
      "pose_mae_dy": 0.25037336349487305,
      "pose_rmse_dtheta": 0.49344402551651,
      "pose_rmse_dx": 0.2939051687717438,
      "pose_rmse_dy": 0.45081377029418945,
      "pose_rmse_mean": 0.41272100806236267,
      "rmse_dtheta": 0.05848211422562599,
      "rmse_dx": 0.031236713752150536,
      "rmse_dy": 0.03211062029004097,
      "rmse_mean": 0.04060981795191765,
      "rotation_flip": 0.015197568573057652,
      "sparse_tokens": 5731.0,
      "step": 6468,
      "turn_loss": 0.5572397112846375,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3005482252369448,
      "grad_norm": 0.43439409136772156,
      "learning_rate": 4.461580631139806e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.010502442717552185,
      "mae_dx": 0.002051769755780697,
      "mae_dy": 0.003130521159619093,
      "pose_mae_dtheta": 0.06765277683734894,
      "pose_mae_dx": 0.02218875288963318,
      "pose_mae_dy": 0.02764183282852173,
      "pose_rmse_dtheta": 0.1550874561071396,
      "pose_rmse_dx": 0.0644797682762146,
      "pose_rmse_dy": 0.0669887363910675,
      "pose_rmse_mean": 0.09551864862442017,
      "rmse_dtheta": 0.02152603678405285,
      "rmse_dx": 0.00667069386690855,
      "rmse_dy": 0.007818713784217834,
      "rmse_mean": 0.012005148455500603,
      "rotation_flip": 0.005791505798697472,
      "sparse_tokens": 32057.0,
      "step": 6469,
      "turn_loss": 0.09434443712234497,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.3005946850027876,
      "grad_norm": 0.8144620656967163,
      "learning_rate": 4.460266119309602e-06,
      "loss": 0.1659,
      "mae_dtheta": 0.019007479771971703,
      "mae_dx": 0.012501886114478111,
      "mae_dy": 0.0064005074091255665,
      "pose_mae_dtheta": 0.13399718701839447,
      "pose_mae_dx": 0.09540308266878128,
      "pose_mae_dy": 0.07828443497419357,
      "pose_rmse_dtheta": 0.19574595987796783,
      "pose_rmse_dx": 0.19470833241939545,
      "pose_rmse_dy": 0.1613166183233261,
      "pose_rmse_mean": 0.1839236468076706,
      "rmse_dtheta": 0.028700973838567734,
      "rmse_dx": 0.024127844721078873,
      "rmse_dy": 0.01064280141144991,
      "rmse_mean": 0.02115720883011818,
      "rotation_flip": 0.011450381949543953,
      "sparse_tokens": 5023.0,
      "step": 6470,
      "turn_loss": 0.2734922468662262,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.30064114476863035,
      "grad_norm": 0.4300791323184967,
      "learning_rate": 4.458951645223279e-06,
      "loss": 0.0817,
      "mae_dtheta": 0.008901371620595455,
      "mae_dx": 0.00127934361808002,
      "mae_dy": 0.0014093308709561825,
      "pose_mae_dtheta": 0.061369992792606354,
      "pose_mae_dx": 0.014991736970841885,
      "pose_mae_dy": 0.020089784637093544,
      "pose_rmse_dtheta": 0.1918877214193344,
      "pose_rmse_dx": 0.03781800717115402,
      "pose_rmse_dy": 0.05474483594298363,
      "pose_rmse_mean": 0.09481685608625412,
      "rmse_dtheta": 0.024165399372577667,
      "rmse_dx": 0.003749595722183585,
      "rmse_dy": 0.003512060735374689,
      "rmse_mean": 0.010475685819983482,
      "rotation_flip": 0.004491018131375313,
      "sparse_tokens": 32105.0,
      "step": 6471,
      "turn_loss": 0.06401795148849487,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.30068760453447313,
      "grad_norm": 0.4063026010990143,
      "learning_rate": 4.457637208972759e-06,
      "loss": 0.094,
      "mae_dtheta": 0.00876519363373518,
      "mae_dx": 0.0017475708154961467,
      "mae_dy": 0.0024456458631902933,
      "pose_mae_dtheta": 0.05944746732711792,
      "pose_mae_dx": 0.02293393202126026,
      "pose_mae_dy": 0.025018520653247833,
      "pose_rmse_dtheta": 0.1431085169315338,
      "pose_rmse_dx": 0.06339140236377716,
      "pose_rmse_dy": 0.05654194951057434,
      "pose_rmse_mean": 0.0876806229352951,
      "rmse_dtheta": 0.018914271146059036,
      "rmse_dx": 0.005575913470238447,
      "rmse_dy": 0.006085831671953201,
      "rmse_mean": 0.010192005895078182,
      "rotation_flip": 0.0023139221593737602,
      "sparse_tokens": 32105.0,
      "step": 6472,
      "turn_loss": 0.08094719052314758,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3007340643003159,
      "grad_norm": 0.4632907807826996,
      "learning_rate": 4.456322810649959e-06,
      "loss": 0.1142,
      "mae_dtheta": 0.013322553597390652,
      "mae_dx": 0.002377506112679839,
      "mae_dy": 0.0031689731404185295,
      "pose_mae_dtheta": 0.08765801042318344,
      "pose_mae_dx": 0.03208375722169876,
      "pose_mae_dy": 0.03639533370733261,
      "pose_rmse_dtheta": 0.2168930619955063,
      "pose_rmse_dx": 0.08454498648643494,
      "pose_rmse_dy": 0.0855650082230568,
      "pose_rmse_mean": 0.12900102138519287,
      "rmse_dtheta": 0.02864987961947918,
      "rmse_dx": 0.006196793634444475,
      "rmse_dy": 0.006911733187735081,
      "rmse_mean": 0.013919468969106674,
      "rotation_flip": 0.004922377876937389,
      "sparse_tokens": 32089.0,
      "step": 6473,
      "turn_loss": 0.1238785982131958,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3007805240661587,
      "grad_norm": 0.3565772473812103,
      "learning_rate": 4.455008450346796e-06,
      "loss": 0.1028,
      "mae_dtheta": 0.005802945699542761,
      "mae_dx": 0.002457213355228305,
      "mae_dy": 0.0020482263062149286,
      "pose_mae_dtheta": 0.04445972293615341,
      "pose_mae_dx": 0.01837315782904625,
      "pose_mae_dy": 0.020070107653737068,
      "pose_rmse_dtheta": 0.15561582148075104,
      "pose_rmse_dx": 0.06569058448076248,
      "pose_rmse_dy": 0.07452081888914108,
      "pose_rmse_mean": 0.0986090824007988,
      "rmse_dtheta": 0.017865296453237534,
      "rmse_dx": 0.008910942822694778,
      "rmse_dy": 0.008061536587774754,
      "rmse_mean": 0.01161259226500988,
      "rotation_flip": 0.003939223475754261,
      "sparse_tokens": 32089.0,
      "step": 6474,
      "turn_loss": 0.07719425112009048,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.30082698383200146,
      "grad_norm": 0.6413695812225342,
      "learning_rate": 4.453694128155187e-06,
      "loss": 0.1798,
      "mae_dtheta": 0.03554527088999748,
      "mae_dx": 0.01381202507764101,
      "mae_dy": 0.007536726072430611,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.641369640827179,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 134.667724609375,
      "model/head/act_norm_mean": 108.96667086693549,
      "model/head/act_norm_min": 84.77775573730469,
      "model/head/act_over_embed": 74.88291638180364,
      "model/head/grad_frac": 0.10907183587551117,
      "model/head/grad_norm": 0.06995536386966705,
      "model/head/grad_zero_frac": 0.00018623852520249784,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7013923891129032,
      "model/head/update_ratio": 0.00119413819629699,
      "model/head/weight_delta": 9.167075157165527,
      "model/head/weight_delta_rel": 0.16081765294075012,
      "model/head/weight_norm": 58.58230209350586,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4213571548461914,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4213571548461914,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4213571548461914,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28956058161813786,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11535553634166718,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07398553937673569,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002390609122812748,
      "model/modality_embedder.encoders.pose/weight_delta": 2.95814847946167,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09665193408727646,
      "model/modality_embedder.encoders.pose/weight_norm": 30.948406219482422,
      "model/modality_embedder/grad_frac": 0.11535553634166718,
      "model/modality_embedder/grad_norm": 0.07398553937673569,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.002390609122812748,
      "model/modality_embedder/weight_delta": 2.95814847946167,
      "model/modality_embedder/weight_delta_rel": 0.09665193408727646,
      "model/modality_embedder/weight_norm": 30.948406219482422,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.47886657714844,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.59753224206349,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.12752914428711,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.216445080323588,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0896652489900589,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.057508569210767746,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002062693005427718,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3710646629333496,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.086403027176857,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.880334854125977,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.71883392333984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.41722870263697,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.925857543945312,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.779748162148856,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.1034989133477211,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0663810595870018,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0022397302091121674,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.005704879760742,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10411996394395828,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.637971878051758,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.0616455078125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.053511424731184,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.206411361694336,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.9042169678922,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10013281553983688,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06422214955091476,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0020987982861697674,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.241203784942627,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10883355140686035,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.5994873046875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.41959381103516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.978878648233486,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.20608139038086,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.227347349454927,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1106770858168602,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07098492234945297,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0023782197386026382,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7722880840301514,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09474365413188934,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.847925186157227,
      "model/normalizer/grad_frac": 0.39526116847991943,
      "model/normalizer/grad_norm": 0.2535085082054138,
      "model/normalizer/grad_zero_frac": 0.00022098507906775922,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003229056252166629,
      "model/normalizer/weight_delta": 5.86473274230957,
      "model/normalizer/weight_delta_rel": 0.07553435862064362,
      "model/normalizer/weight_norm": 78.508544921875,
      "pose_mae_dtheta": 0.2980126738548279,
      "pose_mae_dx": 0.10779424756765366,
      "pose_mae_dy": 0.10385602712631226,
      "pose_rmse_dtheta": 0.4905027747154236,
      "pose_rmse_dx": 0.22763510048389435,
      "pose_rmse_dy": 0.20968696475028992,
      "pose_rmse_mean": 0.30927497148513794,
      "rmse_dtheta": 0.053554385900497437,
      "rmse_dx": 0.02692466974258423,
      "rmse_dy": 0.01263224333524704,
      "rmse_mean": 0.0310370996594429,
      "rotation_flip": 0.013806706294417381,
      "sparse_tokens": 8731.0,
      "step": 6475,
      "turn_loss": 0.278698593378067,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.3008734435978443,
      "grad_norm": 0.7955987453460693,
      "learning_rate": 4.4523798441670375e-06,
      "loss": 0.11,
      "mae_dtheta": 0.026965785771608353,
      "mae_dx": 0.00541071780025959,
      "mae_dy": 0.004644328728318214,
      "pose_mae_dtheta": 0.20417535305023193,
      "pose_mae_dx": 0.05190793424844742,
      "pose_mae_dy": 0.06686054170131683,
      "pose_rmse_dtheta": 0.4200005531311035,
      "pose_rmse_dx": 0.13548794388771057,
      "pose_rmse_dy": 0.17292803525924683,
      "pose_rmse_mean": 0.24280551075935364,
      "rmse_dtheta": 0.046239495277404785,
      "rmse_dx": 0.015070132911205292,
      "rmse_dy": 0.010190279223024845,
      "rmse_mean": 0.023833302780985832,
      "rotation_flip": 0.022522522136569023,
      "sparse_tokens": 8631.0,
      "step": 6476,
      "turn_loss": 0.14594943821430206,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.30091990336368707,
      "grad_norm": 0.3690107762813568,
      "learning_rate": 4.451065598474259e-06,
      "loss": 0.0747,
      "mae_dtheta": 0.010457465425133705,
      "mae_dx": 0.0018339052330702543,
      "mae_dy": 0.0027735044714063406,
      "pose_mae_dtheta": 0.07533428817987442,
      "pose_mae_dx": 0.026833228766918182,
      "pose_mae_dy": 0.033603958785533905,
      "pose_rmse_dtheta": 0.18249733746051788,
      "pose_rmse_dx": 0.07243707776069641,
      "pose_rmse_dy": 0.1009906604886055,
      "pose_rmse_mean": 0.118641696870327,
      "rmse_dtheta": 0.022969428449869156,
      "rmse_dx": 0.005402226001024246,
      "rmse_dy": 0.006699428893625736,
      "rmse_mean": 0.011690361425280571,
      "rotation_flip": 0.003961267415434122,
      "sparse_tokens": 32057.0,
      "step": 6477,
      "turn_loss": 0.08029524236917496,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.30096636312952985,
      "grad_norm": 0.5703266263008118,
      "learning_rate": 4.449751391168762e-06,
      "loss": 0.1264,
      "mae_dtheta": 0.03399250656366348,
      "mae_dx": 0.01116236113011837,
      "mae_dy": 0.006601513363420963,
      "pose_mae_dtheta": 0.27997323870658875,
      "pose_mae_dx": 0.11795754730701447,
      "pose_mae_dy": 0.10023460537195206,
      "pose_rmse_dtheta": 0.4809724986553192,
      "pose_rmse_dx": 0.2600288987159729,
      "pose_rmse_dy": 0.18455980718135834,
      "pose_rmse_mean": 0.3085204064846039,
      "rmse_dtheta": 0.05163455009460449,
      "rmse_dx": 0.02473309263586998,
      "rmse_dy": 0.011023343540728092,
      "rmse_mean": 0.029130330309271812,
      "rotation_flip": 0.0065645514987409115,
      "sparse_tokens": 9399.0,
      "step": 6478,
      "turn_loss": 0.30296623706817627,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 3915.0,
      "epoch": 0.3010128228953726,
      "grad_norm": 0.8736831545829773,
      "learning_rate": 4.448437222342441e-06,
      "loss": 0.1774,
      "mae_dtheta": 0.026021650061011314,
      "mae_dx": 0.013044399209320545,
      "mae_dy": 0.005004179198294878,
      "pose_mae_dtheta": 0.19953501224517822,
      "pose_mae_dx": 0.09244141727685928,
      "pose_mae_dy": 0.06450507789850235,
      "pose_rmse_dtheta": 0.3417570888996124,
      "pose_rmse_dx": 0.1922634392976761,
      "pose_rmse_dy": 0.1291126012802124,
      "pose_rmse_mean": 0.2210443913936615,
      "rmse_dtheta": 0.04095405712723732,
      "rmse_dx": 0.024440959095954895,
      "rmse_dy": 0.009083397686481476,
      "rmse_mean": 0.024826137349009514,
      "rotation_flip": 0.007874015718698502,
      "sparse_tokens": 3352.0,
      "step": 6479,
      "turn_loss": 0.3005194365978241,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.3010592826612154,
      "grad_norm": 0.5871440768241882,
      "learning_rate": 4.447123092087205e-06,
      "loss": 0.1591,
      "mae_dtheta": 0.030273839831352234,
      "mae_dx": 0.015150528401136398,
      "mae_dy": 0.005799649283289909,
      "pose_mae_dtheta": 0.22430114448070526,
      "pose_mae_dx": 0.11764360964298248,
      "pose_mae_dy": 0.06788891553878784,
      "pose_rmse_dtheta": 0.39818045496940613,
      "pose_rmse_dx": 0.23981469869613647,
      "pose_rmse_dy": 0.16059868037700653,
      "pose_rmse_mean": 0.26619794964790344,
      "rmse_dtheta": 0.047253455966711044,
      "rmse_dx": 0.027850201353430748,
      "rmse_dy": 0.010866070166230202,
      "rmse_mean": 0.028656575828790665,
      "rotation_flip": 0.010920437052845955,
      "sparse_tokens": 10813.0,
      "step": 6480,
      "turn_loss": 0.2796214520931244,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3011057424270582,
      "grad_norm": 0.38351303339004517,
      "learning_rate": 4.445809000494945e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.009474637918174267,
      "mae_dx": 0.0014754176372662187,
      "mae_dy": 0.0020556875970214605,
      "pose_mae_dtheta": 0.06800733506679535,
      "pose_mae_dx": 0.017907822504639626,
      "pose_mae_dy": 0.024080239236354828,
      "pose_rmse_dtheta": 0.20489878952503204,
      "pose_rmse_dx": 0.046538617461919785,
      "pose_rmse_dy": 0.05362223461270332,
      "pose_rmse_mean": 0.10168655216693878,
      "rmse_dtheta": 0.024550115689635277,
      "rmse_dx": 0.004476987291127443,
      "rmse_dy": 0.0048396652564406395,
      "rmse_mean": 0.011288922280073166,
      "rotation_flip": 0.0009208103292621672,
      "sparse_tokens": 32073.0,
      "step": 6481,
      "turn_loss": 0.07123443484306335,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.30115220219290095,
      "grad_norm": 0.6619681715965271,
      "learning_rate": 4.44449494765756e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.010968426242470741,
      "mae_dx": 0.0016993492608889937,
      "mae_dy": 0.0025289186742156744,
      "pose_mae_dtheta": 0.06621769070625305,
      "pose_mae_dx": 0.022921761497855186,
      "pose_mae_dy": 0.02806592546403408,
      "pose_rmse_dtheta": 0.12373856455087662,
      "pose_rmse_dx": 0.05190754681825638,
      "pose_rmse_dy": 0.05616254732012749,
      "pose_rmse_mean": 0.0772695541381836,
      "rmse_dtheta": 0.019810684025287628,
      "rmse_dx": 0.004921796731650829,
      "rmse_dy": 0.004527546465396881,
      "rmse_mean": 0.009753342717885971,
      "rotation_flip": 0.004952129442244768,
      "sparse_tokens": 32121.0,
      "step": 6482,
      "turn_loss": 0.09229197353124619,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30119866195874373,
      "grad_norm": 0.6456624865531921,
      "learning_rate": 4.443180933666943e-06,
      "loss": 0.1278,
      "mae_dtheta": 0.009087939746677876,
      "mae_dx": 0.0014385407557711005,
      "mae_dy": 0.0023210772778838873,
      "pose_mae_dtheta": 0.06229126825928688,
      "pose_mae_dx": 0.017336584627628326,
      "pose_mae_dy": 0.028858989477157593,
      "pose_rmse_dtheta": 0.15148518979549408,
      "pose_rmse_dx": 0.05274919047951698,
      "pose_rmse_dy": 0.06414235383272171,
      "pose_rmse_mean": 0.08945891261100769,
      "rmse_dtheta": 0.020188823342323303,
      "rmse_dx": 0.004578344523906708,
      "rmse_dy": 0.005752853583544493,
      "rmse_mean": 0.010173341259360313,
      "rotation_flip": 0.005347593687474728,
      "sparse_tokens": 32089.0,
      "step": 6483,
      "turn_loss": 0.07918214052915573,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3012451217245865,
      "grad_norm": 0.42934703826904297,
      "learning_rate": 4.44186695861498e-06,
      "loss": 0.104,
      "mae_dtheta": 0.009951062500476837,
      "mae_dx": 0.0016372065292671323,
      "mae_dy": 0.0022122622467577457,
      "pose_mae_dtheta": 0.07041912525892258,
      "pose_mae_dx": 0.02070642076432705,
      "pose_mae_dy": 0.025815516710281372,
      "pose_rmse_dtheta": 0.17934219539165497,
      "pose_rmse_dx": 0.05031663551926613,
      "pose_rmse_dy": 0.05869261920452118,
      "pose_rmse_mean": 0.09611715376377106,
      "rmse_dtheta": 0.02131829597055912,
      "rmse_dx": 0.004744154401123524,
      "rmse_dy": 0.004890283104032278,
      "rmse_mean": 0.010317578911781311,
      "rotation_flip": 0.004809343721717596,
      "sparse_tokens": 32169.0,
      "step": 6484,
      "turn_loss": 0.08351453393697739,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19155.0,
      "epoch": 0.3012915814904293,
      "grad_norm": 0.45380136370658875,
      "learning_rate": 4.440553022593562e-06,
      "loss": 0.1078,
      "mae_dtheta": 0.030649105086922646,
      "mae_dx": 0.006301396060734987,
      "mae_dy": 0.010565864853560925,
      "pose_mae_dtheta": 0.1869146078824997,
      "pose_mae_dx": 0.06648126989603043,
      "pose_mae_dy": 0.11326746642589569,
      "pose_rmse_dtheta": 0.3337700664997101,
      "pose_rmse_dx": 0.1399967223405838,
      "pose_rmse_dy": 0.2317504584789276,
      "pose_rmse_mean": 0.23517243564128876,
      "rmse_dtheta": 0.04650905728340149,
      "rmse_dx": 0.01407937053591013,
      "rmse_dy": 0.022220145910978317,
      "rmse_mean": 0.02760285697877407,
      "rotation_flip": 0.02083333395421505,
      "sparse_tokens": 15342.0,
      "step": 6485,
      "turn_loss": 0.3546810448169708,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.30133804125627206,
      "grad_norm": 0.3746442198753357,
      "learning_rate": 4.43923912569457e-06,
      "loss": 0.0832,
      "mae_dtheta": 0.027593843638896942,
      "mae_dx": 0.008389127440750599,
      "mae_dy": 0.004803499672561884,
      "pose_mae_dtheta": 0.22319304943084717,
      "pose_mae_dx": 0.0780697911977768,
      "pose_mae_dy": 0.06234164908528328,
      "pose_rmse_dtheta": 0.40301087498664856,
      "pose_rmse_dx": 0.16077955067157745,
      "pose_rmse_dy": 0.14071017503738403,
      "pose_rmse_mean": 0.23483353853225708,
      "rmse_dtheta": 0.04335182532668114,
      "rmse_dx": 0.018529457971453667,
      "rmse_dy": 0.009199794381856918,
      "rmse_mean": 0.023693691939115524,
      "rotation_flip": 0.007352941203862429,
      "sparse_tokens": 12370.0,
      "step": 6486,
      "turn_loss": 0.21855029463768005,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30138450102211484,
      "grad_norm": 0.5588598847389221,
      "learning_rate": 4.4379252680098875e-06,
      "loss": 0.1634,
      "mae_dtheta": 0.012490564025938511,
      "mae_dx": 0.002111911540850997,
      "mae_dy": 0.003945626318454742,
      "pose_mae_dtheta": 0.07979179918766022,
      "pose_mae_dx": 0.029458394274115562,
      "pose_mae_dy": 0.03763674199581146,
      "pose_rmse_dtheta": 0.16665659844875336,
      "pose_rmse_dx": 0.06456001102924347,
      "pose_rmse_dy": 0.07367882877588272,
      "pose_rmse_mean": 0.10163181275129318,
      "rmse_dtheta": 0.023335257545113564,
      "rmse_dx": 0.005370792932808399,
      "rmse_dy": 0.007163626607507467,
      "rmse_mean": 0.011956559494137764,
      "rotation_flip": 0.005800838116556406,
      "sparse_tokens": 32089.0,
      "step": 6487,
      "turn_loss": 0.10785432904958725,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3014309607879576,
      "grad_norm": 0.8839621543884277,
      "learning_rate": 4.436611449631392e-06,
      "loss": 0.1389,
      "mae_dtheta": 0.009113321080803871,
      "mae_dx": 0.0017903612460941076,
      "mae_dy": 0.0016281179850921035,
      "pose_mae_dtheta": 0.06275507807731628,
      "pose_mae_dx": 0.019365599378943443,
      "pose_mae_dy": 0.01988893374800682,
      "pose_rmse_dtheta": 0.17882348597049713,
      "pose_rmse_dx": 0.05200096592307091,
      "pose_rmse_dy": 0.04024302214384079,
      "pose_rmse_mean": 0.09035582840442657,
      "rmse_dtheta": 0.02049722708761692,
      "rmse_dx": 0.006340935360640287,
      "rmse_dy": 0.003122996771708131,
      "rmse_mean": 0.009987053461372852,
      "rotation_flip": 0.004921700339764357,
      "sparse_tokens": 32105.0,
      "step": 6488,
      "turn_loss": 0.07885922491550446,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3014774205538004,
      "grad_norm": 0.45869600772857666,
      "learning_rate": 4.435297670650961e-06,
      "loss": 0.0923,
      "mae_dtheta": 0.007776651997119188,
      "mae_dx": 0.0012949672527611256,
      "mae_dy": 0.001284423633478582,
      "pose_mae_dtheta": 0.055153921246528625,
      "pose_mae_dx": 0.011578718200325966,
      "pose_mae_dy": 0.018058618530631065,
      "pose_rmse_dtheta": 0.16112664341926575,
      "pose_rmse_dx": 0.03282899037003517,
      "pose_rmse_dy": 0.04172969236969948,
      "pose_rmse_mean": 0.07856177538633347,
      "rmse_dtheta": 0.02108651027083397,
      "rmse_dx": 0.004924489185214043,
      "rmse_dy": 0.004316387698054314,
      "rmse_mean": 0.0101091293618083,
      "rotation_flip": 0.005250875372439623,
      "sparse_tokens": 32073.0,
      "step": 6489,
      "turn_loss": 0.07419043034315109,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.30152388031964317,
      "grad_norm": 0.4241882860660553,
      "learning_rate": 4.4339839311604675e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.009439703077077866,
      "mae_dx": 0.0012616947060450912,
      "mae_dy": 0.0017412626184523106,
      "pose_mae_dtheta": 0.0653252825140953,
      "pose_mae_dx": 0.018001612275838852,
      "pose_mae_dy": 0.02282068505883217,
      "pose_rmse_dtheta": 0.20392288267612457,
      "pose_rmse_dx": 0.050494980067014694,
      "pose_rmse_dy": 0.05997387319803238,
      "pose_rmse_mean": 0.10479724407196045,
      "rmse_dtheta": 0.024274881929159164,
      "rmse_dx": 0.0033580788876861334,
      "rmse_dy": 0.004045513924211264,
      "rmse_mean": 0.01055949181318283,
      "rotation_flip": 0.0,
      "sparse_tokens": 32153.0,
      "step": 6490,
      "turn_loss": 0.06729840487241745,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.30157034008548594,
      "grad_norm": 0.5267394781112671,
      "learning_rate": 4.43267023125178e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.027218597009778023,
      "mae_dx": 0.009542844258248806,
      "mae_dy": 0.003805475076660514,
      "pose_mae_dtheta": 0.19689828157424927,
      "pose_mae_dx": 0.06767787784337997,
      "pose_mae_dy": 0.04479403793811798,
      "pose_rmse_dtheta": 0.35713672637939453,
      "pose_rmse_dx": 0.17549312114715576,
      "pose_rmse_dy": 0.09398162364959717,
      "pose_rmse_mean": 0.20887050032615662,
      "rmse_dtheta": 0.042791567742824554,
      "rmse_dx": 0.02163642644882202,
      "rmse_dy": 0.00717466464266181,
      "rmse_mean": 0.02386755309998989,
      "rotation_flip": 0.019021738320589066,
      "sparse_tokens": 19173.0,
      "step": 6491,
      "turn_loss": 0.21945872902870178,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3016167998513288,
      "grad_norm": 0.6360209584236145,
      "learning_rate": 4.43135657101677e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.0070967222563922405,
      "mae_dx": 0.001150451716966927,
      "mae_dy": 0.0011141167487949133,
      "pose_mae_dtheta": 0.04874935746192932,
      "pose_mae_dx": 0.01269489899277687,
      "pose_mae_dy": 0.015331821516156197,
      "pose_rmse_dtheta": 0.16367684304714203,
      "pose_rmse_dx": 0.035354774445295334,
      "pose_rmse_dy": 0.041758615523576736,
      "pose_rmse_mean": 0.0802634134888649,
      "rmse_dtheta": 0.02058647759258747,
      "rmse_dx": 0.003447318682447076,
      "rmse_dy": 0.002807802287861705,
      "rmse_mean": 0.008947199210524559,
      "rotation_flip": 0.0016958733322098851,
      "sparse_tokens": 32105.0,
      "step": 6492,
      "turn_loss": 0.04544095695018768,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19743.0,
      "epoch": 0.30166325961717155,
      "grad_norm": 0.3669723868370056,
      "learning_rate": 4.430042950547298e-06,
      "loss": 0.094,
      "mae_dtheta": 0.0277608223259449,
      "mae_dx": 0.010609700344502926,
      "mae_dy": 0.0039032595232129097,
      "pose_mae_dtheta": 0.20885777473449707,
      "pose_mae_dx": 0.08903966099023819,
      "pose_mae_dy": 0.052637968212366104,
      "pose_rmse_dtheta": 0.39480334520339966,
      "pose_rmse_dx": 0.21279776096343994,
      "pose_rmse_dy": 0.11433824151754379,
      "pose_rmse_mean": 0.24064645171165466,
      "rmse_dtheta": 0.044713519513607025,
      "rmse_dx": 0.023290416225790977,
      "rmse_dy": 0.006669477093964815,
      "rmse_mean": 0.024891138076782227,
      "rotation_flip": 0.006726457271724939,
      "sparse_tokens": 16306.0,
      "step": 6493,
      "turn_loss": 0.20224684476852417,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.30170971938301433,
      "grad_norm": 0.39291465282440186,
      "learning_rate": 4.42872936993523e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.0315970815718174,
      "mae_dx": 0.009192726574838161,
      "mae_dy": 0.006161166355013847,
      "pose_mae_dtheta": 0.24000519514083862,
      "pose_mae_dx": 0.07992499321699142,
      "pose_mae_dy": 0.0760222002863884,
      "pose_rmse_dtheta": 0.4278649389743805,
      "pose_rmse_dx": 0.16885624825954437,
      "pose_rmse_dy": 0.171510249376297,
      "pose_rmse_mean": 0.2560771405696869,
      "rmse_dtheta": 0.048745885491371155,
      "rmse_dx": 0.019117146730422974,
      "rmse_dy": 0.012590670958161354,
      "rmse_mean": 0.02681790105998516,
      "rotation_flip": 0.014940239489078522,
      "sparse_tokens": 19676.0,
      "step": 6494,
      "turn_loss": 0.24471253156661987,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.3017561791488571,
      "grad_norm": 0.5975499153137207,
      "learning_rate": 4.427415829272422e-06,
      "loss": 0.1525,
      "mae_dtheta": 0.022098181769251823,
      "mae_dx": 0.012803038582205772,
      "mae_dy": 0.002574149752035737,
      "pose_mae_dtheta": 0.17603269219398499,
      "pose_mae_dx": 0.11626478284597397,
      "pose_mae_dy": 0.03791499137878418,
      "pose_rmse_dtheta": 0.3042599856853485,
      "pose_rmse_dx": 0.23360271751880646,
      "pose_rmse_dy": 0.0858333483338356,
      "pose_rmse_mean": 0.20789870619773865,
      "rmse_dtheta": 0.03818735107779503,
      "rmse_dx": 0.023085856810212135,
      "rmse_dy": 0.004923996049910784,
      "rmse_mean": 0.02206573635339737,
      "rotation_flip": 0.017543859779834747,
      "sparse_tokens": 6947.0,
      "step": 6495,
      "turn_loss": 0.22171489894390106,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3018026389146999,
      "grad_norm": 0.6462758779525757,
      "learning_rate": 4.426102328650732e-06,
      "loss": 0.0958,
      "mae_dtheta": 0.00863576214760542,
      "mae_dx": 0.0020936056971549988,
      "mae_dy": 0.0021302918903529644,
      "pose_mae_dtheta": 0.056079428642988205,
      "pose_mae_dx": 0.02091483399271965,
      "pose_mae_dy": 0.02541995793581009,
      "pose_rmse_dtheta": 0.12609480321407318,
      "pose_rmse_dx": 0.05465202033519745,
      "pose_rmse_dy": 0.055627260357141495,
      "pose_rmse_mean": 0.07879136502742767,
      "rmse_dtheta": 0.019948894158005714,
      "rmse_dx": 0.006658769212663174,
      "rmse_dy": 0.004979741293936968,
      "rmse_mean": 0.010529134422540665,
      "rotation_flip": 0.004492699168622494,
      "sparse_tokens": 32105.0,
      "step": 6496,
      "turn_loss": 0.08862956613302231,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.30184909868054266,
      "grad_norm": 0.7186830043792725,
      "learning_rate": 4.4247888681620165e-06,
      "loss": 0.1661,
      "mae_dtheta": 0.02988097257912159,
      "mae_dx": 0.008123871870338917,
      "mae_dy": 0.003163475077599287,
      "pose_mae_dtheta": 0.2535608112812042,
      "pose_mae_dx": 0.07374576479196548,
      "pose_mae_dy": 0.02838205173611641,
      "pose_rmse_dtheta": 0.49604302644729614,
      "pose_rmse_dx": 0.1748436838388443,
      "pose_rmse_dy": 0.06924005597829819,
      "pose_rmse_mean": 0.2467089146375656,
      "rmse_dtheta": 0.05176819488406181,
      "rmse_dx": 0.018247781321406364,
      "rmse_dy": 0.007488394621759653,
      "rmse_mean": 0.025834789499640465,
      "rotation_flip": 0.005917159840464592,
      "sparse_tokens": 7257.0,
      "step": 6497,
      "turn_loss": 0.16583172976970673,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30189555844638544,
      "grad_norm": 0.6281771659851074,
      "learning_rate": 4.423475447898122e-06,
      "loss": 0.1516,
      "mae_dtheta": 0.013823078013956547,
      "mae_dx": 0.0032665005419403315,
      "mae_dy": 0.005685962270945311,
      "pose_mae_dtheta": 0.09850520640611649,
      "pose_mae_dx": 0.04087704047560692,
      "pose_mae_dy": 0.049972791224718094,
      "pose_rmse_dtheta": 0.19664335250854492,
      "pose_rmse_dx": 0.10756034404039383,
      "pose_rmse_dy": 0.11134584248065948,
      "pose_rmse_mean": 0.13851651549339294,
      "rmse_dtheta": 0.02556806616485119,
      "rmse_dx": 0.008115917444229126,
      "rmse_dy": 0.011296510696411133,
      "rmse_mean": 0.014993499033153057,
      "rotation_flip": 0.007863247767090797,
      "sparse_tokens": 32089.0,
      "step": 6498,
      "turn_loss": 0.1576710194349289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3019420182122282,
      "grad_norm": 0.5055679678916931,
      "learning_rate": 4.4221620679509016e-06,
      "loss": 0.1291,
      "mae_dtheta": 0.008940967731177807,
      "mae_dx": 0.0013146298006176949,
      "mae_dy": 0.0013272357173264027,
      "pose_mae_dtheta": 0.06585191935300827,
      "pose_mae_dx": 0.013319469057023525,
      "pose_mae_dy": 0.01410559844225645,
      "pose_rmse_dtheta": 0.22226040065288544,
      "pose_rmse_dx": 0.03402923792600632,
      "pose_rmse_dy": 0.03692947328090668,
      "pose_rmse_mean": 0.09773969650268555,
      "rmse_dtheta": 0.026130132377147675,
      "rmse_dx": 0.003912965767085552,
      "rmse_dy": 0.0031811343505978584,
      "rmse_mean": 0.011074744164943695,
      "rotation_flip": 0.0028436018619686365,
      "sparse_tokens": 32153.0,
      "step": 6499,
      "turn_loss": 0.07128261029720306,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.301988477978071,
      "grad_norm": 0.4908711612224579,
      "learning_rate": 4.420848728412196e-06,
      "loss": 0.1222,
      "mae_dtheta": 0.008864274248480797,
      "mae_dx": 0.002024855697527528,
      "mae_dy": 0.0016688060713931918,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.49087122082710266,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.57911682128906,
      "model/head/act_norm_mean": 122.7587002840909,
      "model/head/act_norm_min": 58.010250091552734,
      "model/head/act_over_embed": 84.36092812028662,
      "model/head/grad_frac": 0.11819969862699509,
      "model/head/grad_norm": 0.058020830154418945,
      "model/head/grad_zero_frac": 0.0001843349018599838,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6921164772727273,
      "model/head/update_ratio": 0.0009903779719024897,
      "model/head/weight_delta": 9.178070068359375,
      "model/head/weight_delta_rel": 0.1610105335712433,
      "model/head/weight_norm": 58.58453369140625,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4214358329772949,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4213783167585542,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42131268978118896,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28957512428243454,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09066211432218552,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04450342431664467,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5462981276371308,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014379429630935192,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9659130573272705,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09690562635660172,
      "model/modality_embedder.encoders.pose/weight_norm": 30.94936752319336,
      "model/modality_embedder/grad_frac": 0.09066211432218552,
      "model/modality_embedder/grad_norm": 0.04450342431664467,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5462981276371308,
      "model/modality_embedder/update_ratio": 0.0014379429630935192,
      "model/modality_embedder/weight_delta": 2.9659130573272705,
      "model/modality_embedder/weight_delta_rel": 0.09690562635660172,
      "model/modality_embedder/weight_norm": 30.94936752319336,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.18866729736328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.936786014911014,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.046950340270996,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.13679281131577,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11069507896900177,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.054337028414011,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019488711841404438,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3754680156707764,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08656349033117294,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.881282806396484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.2850570678711,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.99201589305756,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.08430004119873,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.861956662795848,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.11455421894788742,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05623136833310127,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018971856916323304,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.0113487243652344,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10431547462940216,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.639358520507812,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.99456024169922,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.860314454064454,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.037737846374512,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.145868925206493,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11990473419427872,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05885778367519379,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019233827479183674,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.247528553009033,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10904593020677567,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.601181030273438,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.91370391845703,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.57370580808081,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.079686164855957,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.32332750470912,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1091919019818306,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05359916388988495,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017956704832613468,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7775886058807373,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09492480009794235,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.849109649658203,
      "model/normalizer/grad_frac": 0.43011385202407837,
      "model/normalizer/grad_norm": 0.2111305147409439,
      "model/normalizer/grad_zero_frac": 0.0001689885975793004,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002689208835363388,
      "model/normalizer/weight_delta": 5.8759260177612305,
      "model/normalizer/weight_delta_rel": 0.07567852735519409,
      "model/normalizer/weight_norm": 78.51026916503906,
      "pose_mae_dtheta": 0.061829809099435806,
      "pose_mae_dx": 0.016471413895487785,
      "pose_mae_dy": 0.013031420297920704,
      "pose_rmse_dtheta": 0.2013453096151352,
      "pose_rmse_dx": 0.04495221748948097,
      "pose_rmse_dy": 0.04158690199255943,
      "pose_rmse_mean": 0.09596147388219833,
      "rmse_dtheta": 0.02553895302116871,
      "rmse_dx": 0.005604562349617481,
      "rmse_dy": 0.005934061482548714,
      "rmse_mean": 0.012359192594885826,
      "rotation_flip": 0.0018527095671743155,
      "sparse_tokens": 32217.0,
      "step": 6500,
      "turn_loss": 0.06420987099409103,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.30203493774391377,
      "grad_norm": 0.7868196964263916,
      "learning_rate": 4.4195354293738484e-06,
      "loss": 0.2346,
      "mae_dtheta": 0.030035678297281265,
      "mae_dx": 0.011966686695814133,
      "mae_dy": 0.005494844634085894,
      "pose_mae_dtheta": 0.22323952615261078,
      "pose_mae_dx": 0.09125974774360657,
      "pose_mae_dy": 0.05307786166667938,
      "pose_rmse_dtheta": 0.4109722673892975,
      "pose_rmse_dx": 0.18532109260559082,
      "pose_rmse_dy": 0.11446765810251236,
      "pose_rmse_mean": 0.2369203418493271,
      "rmse_dtheta": 0.047023706138134,
      "rmse_dx": 0.023156924173235893,
      "rmse_dy": 0.010552369989454746,
      "rmse_mean": 0.026911001652479172,
      "rotation_flip": 0.021164020523428917,
      "sparse_tokens": 18313.0,
      "step": 6501,
      "turn_loss": 0.27436044812202454,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.30208139750975654,
      "grad_norm": 0.57071453332901,
      "learning_rate": 4.418222170927703e-06,
      "loss": 0.1519,
      "mae_dtheta": 0.007963098585605621,
      "mae_dx": 0.001274098176509142,
      "mae_dy": 0.0014935018261894584,
      "pose_mae_dtheta": 0.055117469280958176,
      "pose_mae_dx": 0.0154982665553689,
      "pose_mae_dy": 0.01916756108403206,
      "pose_rmse_dtheta": 0.1663752794265747,
      "pose_rmse_dx": 0.04176981374621391,
      "pose_rmse_dy": 0.046475883573293686,
      "pose_rmse_mean": 0.08487366139888763,
      "rmse_dtheta": 0.021841006353497505,
      "rmse_dx": 0.004358789883553982,
      "rmse_dy": 0.0034807517658919096,
      "rmse_mean": 0.009893516078591347,
      "rotation_flip": 0.0029097963124513626,
      "sparse_tokens": 32105.0,
      "step": 6502,
      "turn_loss": 0.05985340103507042,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.3021278572755993,
      "grad_norm": 0.6298680901527405,
      "learning_rate": 4.4169089531655905e-06,
      "loss": 0.2019,
      "mae_dtheta": 0.04627447947859764,
      "mae_dx": 0.008170824497938156,
      "mae_dy": 0.004260957706719637,
      "pose_mae_dtheta": 0.41151565313339233,
      "pose_mae_dx": 0.0545392744243145,
      "pose_mae_dy": 0.02579895779490471,
      "pose_rmse_dtheta": 0.671539306640625,
      "pose_rmse_dx": 0.16528518497943878,
      "pose_rmse_dy": 0.056519944220781326,
      "pose_rmse_mean": 0.29778146743774414,
      "rmse_dtheta": 0.06700801849365234,
      "rmse_dx": 0.01977727562189102,
      "rmse_dy": 0.0091717429459095,
      "rmse_mean": 0.031985681504011154,
      "rotation_flip": 0.007299270015209913,
      "sparse_tokens": 3903.0,
      "step": 6503,
      "turn_loss": 0.2804962694644928,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3021743170414421,
      "grad_norm": 0.4361342489719391,
      "learning_rate": 4.41559577617935e-06,
      "loss": 0.0884,
      "mae_dtheta": 0.006524475757032633,
      "mae_dx": 0.001765034394338727,
      "mae_dy": 0.0016807963838800788,
      "pose_mae_dtheta": 0.04883931577205658,
      "pose_mae_dx": 0.019539352506399155,
      "pose_mae_dy": 0.020772036164999008,
      "pose_rmse_dtheta": 0.11439737677574158,
      "pose_rmse_dx": 0.055858589708805084,
      "pose_rmse_dy": 0.05197460576891899,
      "pose_rmse_mean": 0.07407686114311218,
      "rmse_dtheta": 0.015555976890027523,
      "rmse_dx": 0.00516362302005291,
      "rmse_dy": 0.003976727370172739,
      "rmse_mean": 0.008232109248638153,
      "rotation_flip": 0.0026329646352678537,
      "sparse_tokens": 32089.0,
      "step": 6504,
      "turn_loss": 0.05638369172811508,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3022207768072849,
      "grad_norm": 0.672073483467102,
      "learning_rate": 4.414282640060809e-06,
      "loss": 0.0681,
      "mae_dtheta": 0.008088233880698681,
      "mae_dx": 0.0014176039258018136,
      "mae_dy": 0.0005057204980403185,
      "pose_mae_dtheta": 0.05474042892456055,
      "pose_mae_dx": 0.013646060600876808,
      "pose_mae_dy": 0.007726115174591541,
      "pose_rmse_dtheta": 0.20040422677993774,
      "pose_rmse_dx": 0.03663308545947075,
      "pose_rmse_dy": 0.03561098501086235,
      "pose_rmse_mean": 0.09088277071714401,
      "rmse_dtheta": 0.02737954445183277,
      "rmse_dx": 0.004491145722568035,
      "rmse_dy": 0.002119664568454027,
      "rmse_mean": 0.011330118402838707,
      "rotation_flip": 0.00304692261852324,
      "sparse_tokens": 32201.0,
      "step": 6505,
      "turn_loss": 0.05327841266989708,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.30226723657312765,
      "grad_norm": 0.6995365023612976,
      "learning_rate": 4.412969544901799e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.019227707758545876,
      "mae_dx": 0.009517067112028599,
      "mae_dy": 0.003251988673582673,
      "pose_mae_dtheta": 0.15948550403118134,
      "pose_mae_dx": 0.07605845481157303,
      "pose_mae_dy": 0.04649490863084793,
      "pose_rmse_dtheta": 0.2553647756576538,
      "pose_rmse_dx": 0.18428099155426025,
      "pose_rmse_dy": 0.132123202085495,
      "pose_rmse_mean": 0.19058966636657715,
      "rmse_dtheta": 0.031014926731586456,
      "rmse_dx": 0.020935116335749626,
      "rmse_dy": 0.007116302382200956,
      "rmse_mean": 0.019688783213496208,
      "rotation_flip": 0.015981735661625862,
      "sparse_tokens": 7314.0,
      "step": 6506,
      "turn_loss": 0.1708979606628418,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.30231369633897043,
      "grad_norm": 0.7357253432273865,
      "learning_rate": 4.4116564907941425e-06,
      "loss": 0.0921,
      "mae_dtheta": 0.023046253249049187,
      "mae_dx": 0.009775525890290737,
      "mae_dy": 0.004693828523159027,
      "pose_mae_dtheta": 0.1980234533548355,
      "pose_mae_dx": 0.08079398423433304,
      "pose_mae_dy": 0.06927899271249771,
      "pose_rmse_dtheta": 0.3855328857898712,
      "pose_rmse_dx": 0.21204711496829987,
      "pose_rmse_dy": 0.13763515651226044,
      "pose_rmse_mean": 0.24507173895835876,
      "rmse_dtheta": 0.040394376963377,
      "rmse_dx": 0.0226645078510046,
      "rmse_dy": 0.008771948516368866,
      "rmse_mean": 0.02394361048936844,
      "rotation_flip": 0.0178217813372612,
      "sparse_tokens": 9606.0,
      "step": 6507,
      "turn_loss": 0.19284005463123322,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3023601561048132,
      "grad_norm": 0.6806582808494568,
      "learning_rate": 4.410343477829664e-06,
      "loss": 0.0917,
      "mae_dtheta": 0.006207251455634832,
      "mae_dx": 0.0012634813319891691,
      "mae_dy": 0.0013657129602506757,
      "pose_mae_dtheta": 0.04106907919049263,
      "pose_mae_dx": 0.01852237433195114,
      "pose_mae_dy": 0.0197663065046072,
      "pose_rmse_dtheta": 0.0866253450512886,
      "pose_rmse_dx": 0.048591796308755875,
      "pose_rmse_dy": 0.052797190845012665,
      "pose_rmse_mean": 0.06267144531011581,
      "rmse_dtheta": 0.014983869157731533,
      "rmse_dx": 0.003737848484888673,
      "rmse_dy": 0.003314261557534337,
      "rmse_mean": 0.00734532717615366,
      "rotation_flip": 0.0004716981202363968,
      "sparse_tokens": 32121.0,
      "step": 6508,
      "turn_loss": 0.049151912331581116,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.30240661587065604,
      "grad_norm": 1.0271650552749634,
      "learning_rate": 4.409030506100182e-06,
      "loss": 0.2804,
      "mae_dtheta": 0.04471103847026825,
      "mae_dx": 0.014173565432429314,
      "mae_dy": 0.005777527112513781,
      "pose_mae_dtheta": 0.3495708703994751,
      "pose_mae_dx": 0.11763795465230942,
      "pose_mae_dy": 0.07943493127822876,
      "pose_rmse_dtheta": 0.6116052269935608,
      "pose_rmse_dx": 0.2373913675546646,
      "pose_rmse_dy": 0.17996105551719666,
      "pose_rmse_mean": 0.3429858684539795,
      "rmse_dtheta": 0.06311225146055222,
      "rmse_dx": 0.026749439537525177,
      "rmse_dy": 0.012339510023593903,
      "rmse_mean": 0.0340670682489872,
      "rotation_flip": 0.005780346691608429,
      "sparse_tokens": 6109.0,
      "step": 6509,
      "turn_loss": 0.37449243664741516,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3024530756364988,
      "grad_norm": 0.6835309863090515,
      "learning_rate": 4.407717575697515e-06,
      "loss": 0.139,
      "mae_dtheta": 0.01139636430889368,
      "mae_dx": 0.0023728394880890846,
      "mae_dy": 0.004263574723154306,
      "pose_mae_dtheta": 0.07306475192308426,
      "pose_mae_dx": 0.038438912481069565,
      "pose_mae_dy": 0.035069677978754044,
      "pose_rmse_dtheta": 0.1682068258523941,
      "pose_rmse_dx": 0.10329584777355194,
      "pose_rmse_dy": 0.07978571951389313,
      "pose_rmse_mean": 0.11709612607955933,
      "rmse_dtheta": 0.022817939519882202,
      "rmse_dx": 0.005834338720887899,
      "rmse_dy": 0.009339718148112297,
      "rmse_mean": 0.012663999572396278,
      "rotation_flip": 0.0036912751384079456,
      "sparse_tokens": 32153.0,
      "step": 6510,
      "turn_loss": 0.10583736002445221,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20710.0,
      "epoch": 0.3024995354023416,
      "grad_norm": 0.5347075462341309,
      "learning_rate": 4.4064046867134755e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.03044833615422249,
      "mae_dx": 0.010758275166153908,
      "mae_dy": 0.006889822892844677,
      "pose_mae_dtheta": 0.22947131097316742,
      "pose_mae_dx": 0.10154259204864502,
      "pose_mae_dy": 0.10341570526361465,
      "pose_rmse_dtheta": 0.4068373739719391,
      "pose_rmse_dx": 0.24216146767139435,
      "pose_rmse_dy": 0.2399391084909439,
      "pose_rmse_mean": 0.2963126599788666,
      "rmse_dtheta": 0.046907275915145874,
      "rmse_dx": 0.025299033150076866,
      "rmse_dy": 0.012830962426960468,
      "rmse_mean": 0.028345759958028793,
      "rotation_flip": 0.022002199664711952,
      "sparse_tokens": 16828.0,
      "step": 6511,
      "turn_loss": 0.20896032452583313,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.30254599516818437,
      "grad_norm": 0.48050305247306824,
      "learning_rate": 4.405091839239874e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.02208038792014122,
      "mae_dx": 0.005124673712998629,
      "mae_dy": 0.0035743536427617073,
      "pose_mae_dtheta": 0.15429623425006866,
      "pose_mae_dx": 0.04307805746793747,
      "pose_mae_dy": 0.029805732890963554,
      "pose_rmse_dtheta": 0.30316272377967834,
      "pose_rmse_dx": 0.102791428565979,
      "pose_rmse_dy": 0.07609646022319794,
      "pose_rmse_mean": 0.1606835424900055,
      "rmse_dtheta": 0.039803534746170044,
      "rmse_dx": 0.011916162446141243,
      "rmse_dy": 0.008523662574589252,
      "rmse_mean": 0.02008111961185932,
      "rotation_flip": 0.009646302089095116,
      "sparse_tokens": 5406.0,
      "step": 6512,
      "turn_loss": 0.1802477389574051,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.30259245493402714,
      "grad_norm": 0.37418094277381897,
      "learning_rate": 4.403779033368521e-06,
      "loss": 0.1015,
      "mae_dtheta": 0.007817719131708145,
      "mae_dx": 0.0025299685075879097,
      "mae_dy": 0.0014988159528002143,
      "pose_mae_dtheta": 0.061026692390441895,
      "pose_mae_dx": 0.02574925124645233,
      "pose_mae_dy": 0.018527453765273094,
      "pose_rmse_dtheta": 0.21250759065151215,
      "pose_rmse_dx": 0.08271891623735428,
      "pose_rmse_dy": 0.04677441716194153,
      "pose_rmse_mean": 0.11400031298398972,
      "rmse_dtheta": 0.02238083817064762,
      "rmse_dx": 0.00868428684771061,
      "rmse_dy": 0.003554466413334012,
      "rmse_mean": 0.011539864353835583,
      "rotation_flip": 0.0018867924809455872,
      "sparse_tokens": 32137.0,
      "step": 6513,
      "turn_loss": 0.07251016795635223,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.3026389146998699,
      "grad_norm": 0.5449832677841187,
      "learning_rate": 4.402466269191218e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.029766321182250977,
      "mae_dx": 0.007901051081717014,
      "mae_dy": 0.0028041487094014883,
      "pose_mae_dtheta": 0.23046107590198517,
      "pose_mae_dx": 0.06659016013145447,
      "pose_mae_dy": 0.03800669312477112,
      "pose_rmse_dtheta": 0.42971858382225037,
      "pose_rmse_dx": 0.14753101766109467,
      "pose_rmse_dy": 0.1104045957326889,
      "pose_rmse_mean": 0.22921806573867798,
      "rmse_dtheta": 0.04831591248512268,
      "rmse_dx": 0.018416322767734528,
      "rmse_dy": 0.006604115478694439,
      "rmse_mean": 0.02444544993340969,
      "rotation_flip": 0.014760147780179977,
      "sparse_tokens": 14784.0,
      "step": 6514,
      "turn_loss": 0.20430733263492584,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3026853744657127,
      "grad_norm": 0.3872379660606384,
      "learning_rate": 4.4011535467997695e-06,
      "loss": 0.0637,
      "mae_dtheta": 0.009071800857782364,
      "mae_dx": 0.0016960777575150132,
      "mae_dy": 0.0019852889236062765,
      "pose_mae_dtheta": 0.06279748678207397,
      "pose_mae_dx": 0.0241650752723217,
      "pose_mae_dy": 0.027116842567920685,
      "pose_rmse_dtheta": 0.14535848796367645,
      "pose_rmse_dx": 0.08591434359550476,
      "pose_rmse_dy": 0.06713838875293732,
      "pose_rmse_mean": 0.09947040677070618,
      "rmse_dtheta": 0.019111335277557373,
      "rmse_dx": 0.0064320191740989685,
      "rmse_dy": 0.004841767717152834,
      "rmse_mean": 0.010128374211490154,
      "rotation_flip": 0.0037751677446067333,
      "sparse_tokens": 32057.0,
      "step": 6515,
      "turn_loss": 0.06121577322483063,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3027318342315555,
      "grad_norm": 0.6553704738616943,
      "learning_rate": 4.399840866285977e-06,
      "loss": 0.1358,
      "mae_dtheta": 0.008291682228446007,
      "mae_dx": 0.0012496395502239466,
      "mae_dy": 0.00195400882512331,
      "pose_mae_dtheta": 0.054544974118471146,
      "pose_mae_dx": 0.018919669091701508,
      "pose_mae_dy": 0.02456088177859783,
      "pose_rmse_dtheta": 0.1341121643781662,
      "pose_rmse_dx": 0.059866826981306076,
      "pose_rmse_dy": 0.06698374450206757,
      "pose_rmse_mean": 0.08698757737874985,
      "rmse_dtheta": 0.01978570781648159,
      "rmse_dx": 0.003310536500066519,
      "rmse_dy": 0.004669669549912214,
      "rmse_mean": 0.0092553049325943,
      "rotation_flip": 0.005462185014039278,
      "sparse_tokens": 32089.0,
      "step": 6516,
      "turn_loss": 0.07233939319849014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.30277829399739825,
      "grad_norm": 0.46610307693481445,
      "learning_rate": 4.398528227741634e-06,
      "loss": 0.1018,
      "mae_dtheta": 0.01244006771594286,
      "mae_dx": 0.002827084856107831,
      "mae_dy": 0.0031932152342051268,
      "pose_mae_dtheta": 0.08661910891532898,
      "pose_mae_dx": 0.031689636409282684,
      "pose_mae_dy": 0.039645496755838394,
      "pose_rmse_dtheta": 0.20534838736057281,
      "pose_rmse_dx": 0.09473403543233871,
      "pose_rmse_dy": 0.08986581861972809,
      "pose_rmse_mean": 0.12998275458812714,
      "rmse_dtheta": 0.02632729895412922,
      "rmse_dx": 0.009497915394604206,
      "rmse_dy": 0.007399543654173613,
      "rmse_mean": 0.014408253133296967,
      "rotation_flip": 0.004537953995168209,
      "sparse_tokens": 32057.0,
      "step": 6517,
      "turn_loss": 0.13068799674510956,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.30282475376324103,
      "grad_norm": 0.6799871921539307,
      "learning_rate": 4.397215631258535e-06,
      "loss": 0.1552,
      "mae_dtheta": 0.0319836400449276,
      "mae_dx": 0.012208504602313042,
      "mae_dy": 0.004288581199944019,
      "pose_mae_dtheta": 0.232435405254364,
      "pose_mae_dx": 0.08492350578308105,
      "pose_mae_dy": 0.03997790440917015,
      "pose_rmse_dtheta": 0.41557008028030396,
      "pose_rmse_dx": 0.19071140885353088,
      "pose_rmse_dy": 0.10537494719028473,
      "pose_rmse_mean": 0.23721882700920105,
      "rmse_dtheta": 0.04968990013003349,
      "rmse_dx": 0.02309170924127102,
      "rmse_dy": 0.013979455456137657,
      "rmse_mean": 0.028920356184244156,
      "rotation_flip": 0.010273972526192665,
      "sparse_tokens": 5495.0,
      "step": 6518,
      "turn_loss": 0.33943814039230347,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.3028712135290838,
      "grad_norm": 0.5874869227409363,
      "learning_rate": 4.3959030769284695e-06,
      "loss": 0.0858,
      "mae_dtheta": 0.0340999960899353,
      "mae_dx": 0.011082664132118225,
      "mae_dy": 0.005433615762740374,
      "pose_mae_dtheta": 0.2771395444869995,
      "pose_mae_dx": 0.09616927057504654,
      "pose_mae_dy": 0.06436160951852798,
      "pose_rmse_dtheta": 0.503740131855011,
      "pose_rmse_dx": 0.22926534712314606,
      "pose_rmse_dy": 0.1577557623386383,
      "pose_rmse_mean": 0.29692041873931885,
      "rmse_dtheta": 0.05227208510041237,
      "rmse_dx": 0.02426142990589142,
      "rmse_dy": 0.010296271182596684,
      "rmse_mean": 0.02894326113164425,
      "rotation_flip": 0.008486563339829445,
      "sparse_tokens": 12019.0,
      "step": 6519,
      "turn_loss": 0.2793237864971161,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3029176732949266,
      "grad_norm": 0.5241836905479431,
      "learning_rate": 4.394590564843226e-06,
      "loss": 0.1072,
      "mae_dtheta": 0.010428781621158123,
      "mae_dx": 0.0022983746603131294,
      "mae_dy": 0.0032225248869508505,
      "pose_mae_dtheta": 0.06548873335123062,
      "pose_mae_dx": 0.026123978197574615,
      "pose_mae_dy": 0.027373412624001503,
      "pose_rmse_dtheta": 0.15175648033618927,
      "pose_rmse_dx": 0.06315359473228455,
      "pose_rmse_dy": 0.055326901376247406,
      "pose_rmse_mean": 0.09007899463176727,
      "rmse_dtheta": 0.021439388394355774,
      "rmse_dx": 0.005576106254011393,
      "rmse_dy": 0.007438537199050188,
      "rmse_mean": 0.011484677903354168,
      "rotation_flip": 0.010327635332942009,
      "sparse_tokens": 32105.0,
      "step": 6520,
      "turn_loss": 0.09647198021411896,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30296413306076936,
      "grad_norm": 0.38197091221809387,
      "learning_rate": 4.393278095094591e-06,
      "loss": 0.0811,
      "mae_dtheta": 0.007189193740487099,
      "mae_dx": 0.0011698362650349736,
      "mae_dy": 0.001114107551984489,
      "pose_mae_dtheta": 0.058094922453165054,
      "pose_mae_dx": 0.013885626569390297,
      "pose_mae_dy": 0.017269648611545563,
      "pose_rmse_dtheta": 0.21087110042572021,
      "pose_rmse_dx": 0.039435889571905136,
      "pose_rmse_dy": 0.04903499037027359,
      "pose_rmse_mean": 0.09978066384792328,
      "rmse_dtheta": 0.021657349541783333,
      "rmse_dx": 0.00369850336574018,
      "rmse_dy": 0.0027985251508653164,
      "rmse_mean": 0.009384793229401112,
      "rotation_flip": 0.0016304347664117813,
      "sparse_tokens": 32089.0,
      "step": 6521,
      "turn_loss": 0.05335766822099686,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.30301059282661214,
      "grad_norm": 0.45589280128479004,
      "learning_rate": 4.391965667774343e-06,
      "loss": 0.1091,
      "mae_dtheta": 0.012131034396588802,
      "mae_dx": 0.00257419073022902,
      "mae_dy": 0.0028900515753775835,
      "pose_mae_dtheta": 0.08684052526950836,
      "pose_mae_dx": 0.02351745404303074,
      "pose_mae_dy": 0.029506100341677666,
      "pose_rmse_dtheta": 0.25432273745536804,
      "pose_rmse_dx": 0.05616242438554764,
      "pose_rmse_dy": 0.07040473073720932,
      "pose_rmse_mean": 0.1269633024930954,
      "rmse_dtheta": 0.02775450237095356,
      "rmse_dx": 0.008625428192317486,
      "rmse_dy": 0.009313032031059265,
      "rmse_mean": 0.015230987221002579,
      "rotation_flip": 0.012624330818653107,
      "sparse_tokens": 32105.0,
      "step": 6522,
      "turn_loss": 0.11260582506656647,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.3030570525924549,
      "grad_norm": 1.0840837955474854,
      "learning_rate": 4.390653282974264e-06,
      "loss": 0.3756,
      "mae_dtheta": 0.027438797056674957,
      "mae_dx": 0.01261313445866108,
      "mae_dy": 0.0029449090361595154,
      "pose_mae_dtheta": 0.2028658241033554,
      "pose_mae_dx": 0.10855972021818161,
      "pose_mae_dy": 0.05162179470062256,
      "pose_rmse_dtheta": 0.40770870447158813,
      "pose_rmse_dx": 0.2557515501976013,
      "pose_rmse_dy": 0.13158930838108063,
      "pose_rmse_mean": 0.2650165259838104,
      "rmse_dtheta": 0.045050427317619324,
      "rmse_dx": 0.026263447478413582,
      "rmse_dy": 0.0054589565843343735,
      "rmse_mean": 0.025590945035219193,
      "rotation_flip": 0.029535865411162376,
      "sparse_tokens": 5522.0,
      "step": 6523,
      "turn_loss": 0.21965733170509338,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.3031035123582977,
      "grad_norm": 1.349916934967041,
      "learning_rate": 4.389340940786126e-06,
      "loss": 0.2535,
      "mae_dtheta": 0.032150521874427795,
      "mae_dx": 0.007389535661786795,
      "mae_dy": 0.0028632385656237602,
      "pose_mae_dtheta": 0.26602816581726074,
      "pose_mae_dx": 0.051029447466135025,
      "pose_mae_dy": 0.03786042332649231,
      "pose_rmse_dtheta": 0.5134388208389282,
      "pose_rmse_dx": 0.12876610457897186,
      "pose_rmse_dy": 0.09931334853172302,
      "pose_rmse_mean": 0.2471727579832077,
      "rmse_dtheta": 0.05459585785865784,
      "rmse_dx": 0.018594471737742424,
      "rmse_dy": 0.00738395843654871,
      "rmse_mean": 0.026858096942305565,
      "rotation_flip": 0.008645533584058285,
      "sparse_tokens": 5484.0,
      "step": 6524,
      "turn_loss": 0.2219788283109665,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.3031499721241405,
      "grad_norm": 0.4929124414920807,
      "learning_rate": 4.388028641301705e-06,
      "loss": 0.0798,
      "mae_dtheta": 0.03504817187786102,
      "mae_dx": 0.01595708727836609,
      "mae_dy": 0.003643432166427374,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4929124712944031,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 132.99288940429688,
      "model/head/act_norm_mean": 109.14013671875,
      "model/head/act_norm_min": 79.18531799316406,
      "model/head/act_over_embed": 75.00212373918346,
      "model/head/grad_frac": 0.09708935767412186,
      "model/head/grad_norm": 0.04785655438899994,
      "model/head/grad_zero_frac": 0.00015419407282024622,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7000506365740741,
      "model/head/update_ratio": 0.0008168412023223937,
      "model/head/weight_delta": 9.1897611618042,
      "model/head/weight_delta_rel": 0.1612156331539154,
      "model/head/weight_norm": 58.58734130859375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42136478424072266,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42136478424072266,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42136478424072266,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28956582460948727,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12038425356149673,
      "model/modality_embedder.encoders.pose/grad_norm": 0.059338901191949844,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019172702450305223,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9731297492980957,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09714141488075256,
      "model/modality_embedder.encoders.pose/weight_norm": 30.94968032836914,
      "model/modality_embedder/grad_frac": 0.12038425356149673,
      "model/modality_embedder/grad_norm": 0.059338901191949844,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0019172702450305223,
      "model/modality_embedder/weight_delta": 2.9731297492980957,
      "model/modality_embedder/weight_delta_rel": 0.09714141488075256,
      "model/modality_embedder/weight_norm": 30.94968032836914,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.002197265625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.521503894767783,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.235492706298828,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.164197688273376,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0766657292842865,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.037789493799209595,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013552960008382797,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3804173469543457,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08674384653568268,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.88283348083496,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.49069213867188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.348588605967077,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.729582786560059,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.732578045098595,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08017805218696594,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.039520762860774994,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013333240058273077,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.017427444458008,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10452604293823242,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.640779495239258,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.1597900390625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.910321593915345,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.20899486541748,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.80581557559124,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09555407613515854,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04709979519248009,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015390394255518913,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.2540574073791504,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10926515609025955,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.603370666503906,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.15231323242188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.767781360229275,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.2178955078125,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.082279316814486,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12328990548849106,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06077113375067711,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 7.565364649053663e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020358439069241285,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.782724618911743,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09510032087564468,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.8505859375,
      "model/normalizer/grad_frac": 0.47364386916160583,
      "model/normalizer/grad_norm": 0.23346497118473053,
      "model/normalizer/grad_zero_frac": 0.00012526426871772856,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002973604714497924,
      "model/normalizer/weight_delta": 5.887524604797363,
      "model/normalizer/weight_delta_rel": 0.07582791149616241,
      "model/normalizer/weight_norm": 78.51244354248047,
      "pose_mae_dtheta": 0.24236251413822174,
      "pose_mae_dx": 0.12227076292037964,
      "pose_mae_dy": 0.06609704345464706,
      "pose_rmse_dtheta": 0.4506591856479645,
      "pose_rmse_dx": 0.2703973054885864,
      "pose_rmse_dy": 0.15020202100276947,
      "pose_rmse_mean": 0.2904195189476013,
      "rmse_dtheta": 0.05374322459101677,
      "rmse_dx": 0.029725436121225357,
      "rmse_dy": 0.006936525460332632,
      "rmse_mean": 0.03013506345450878,
      "rotation_flip": 0.0,
      "sparse_tokens": 7178.0,
      "step": 6525,
      "turn_loss": 0.2661166489124298,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3031964318899833,
      "grad_norm": 0.467195600271225,
      "learning_rate": 4.386716384612768e-06,
      "loss": 0.115,
      "mae_dtheta": 0.010290196165442467,
      "mae_dx": 0.0022147453855723143,
      "mae_dy": 0.0021571777760982513,
      "pose_mae_dtheta": 0.06800132989883423,
      "pose_mae_dx": 0.01735326088964939,
      "pose_mae_dy": 0.021606411784887314,
      "pose_rmse_dtheta": 0.1832520216703415,
      "pose_rmse_dx": 0.04147568717598915,
      "pose_rmse_dy": 0.05730742961168289,
      "pose_rmse_mean": 0.09401171654462814,
      "rmse_dtheta": 0.02498980239033699,
      "rmse_dx": 0.007855545729398727,
      "rmse_dy": 0.006406649015843868,
      "rmse_mean": 0.01308399997651577,
      "rotation_flip": 0.004085338208824396,
      "sparse_tokens": 32105.0,
      "step": 6526,
      "turn_loss": 0.09266455471515656,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3032428916558261,
      "grad_norm": 0.3396855592727661,
      "learning_rate": 4.385404170811084e-06,
      "loss": 0.0895,
      "mae_dtheta": 0.010310334153473377,
      "mae_dx": 0.001404459704644978,
      "mae_dy": 0.0025174501352012157,
      "pose_mae_dtheta": 0.06710980832576752,
      "pose_mae_dx": 0.01962466351687908,
      "pose_mae_dy": 0.026495689526200294,
      "pose_rmse_dtheta": 0.16945891082286835,
      "pose_rmse_dx": 0.050366755574941635,
      "pose_rmse_dy": 0.07405618578195572,
      "pose_rmse_mean": 0.09796062111854553,
      "rmse_dtheta": 0.02451271004974842,
      "rmse_dx": 0.003829377703368664,
      "rmse_dy": 0.0059485589154064655,
      "rmse_mean": 0.01143021509051323,
      "rotation_flip": 0.007120253052562475,
      "sparse_tokens": 32073.0,
      "step": 6527,
      "turn_loss": 0.06978792697191238,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30328935142166885,
      "grad_norm": 0.48229318857192993,
      "learning_rate": 4.384091999988417e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.008906451985239983,
      "mae_dx": 0.002109211403876543,
      "mae_dy": 0.0023261653259396553,
      "pose_mae_dtheta": 0.06654956936836243,
      "pose_mae_dx": 0.02376794070005417,
      "pose_mae_dy": 0.022838614881038666,
      "pose_rmse_dtheta": 0.1702326238155365,
      "pose_rmse_dx": 0.06920211762189865,
      "pose_rmse_dy": 0.05329084023833275,
      "pose_rmse_mean": 0.09757520258426666,
      "rmse_dtheta": 0.02164527215063572,
      "rmse_dx": 0.0071451710537076,
      "rmse_dy": 0.00626753643155098,
      "rmse_mean": 0.011685993522405624,
      "rotation_flip": 0.008360426872968674,
      "sparse_tokens": 32089.0,
      "step": 6528,
      "turn_loss": 0.06850721687078476,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.30333581118751163,
      "grad_norm": 0.3428201675415039,
      "learning_rate": 4.382779872236527e-06,
      "loss": 0.0806,
      "mae_dtheta": 0.00962546281516552,
      "mae_dx": 0.0016706668538972735,
      "mae_dy": 0.0018935386324301362,
      "pose_mae_dtheta": 0.06507723778486252,
      "pose_mae_dx": 0.020711960271000862,
      "pose_mae_dy": 0.02334422431886196,
      "pose_rmse_dtheta": 0.17380064725875854,
      "pose_rmse_dx": 0.05146310105919838,
      "pose_rmse_dy": 0.05145752429962158,
      "pose_rmse_mean": 0.09224042296409607,
      "rmse_dtheta": 0.02139231003820896,
      "rmse_dx": 0.00559754204005003,
      "rmse_dy": 0.0037103588692843914,
      "rmse_mean": 0.010233404114842415,
      "rotation_flip": 0.002061855746433139,
      "sparse_tokens": 32105.0,
      "step": 6529,
      "turn_loss": 0.06994383037090302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.3033822709533544,
      "grad_norm": 0.43089455366134644,
      "learning_rate": 4.381467787647173e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.040223632007837296,
      "mae_dx": 0.013845537789165974,
      "mae_dy": 0.0026821109931916,
      "pose_mae_dtheta": 0.34304139018058777,
      "pose_mae_dx": 0.11276561766862869,
      "pose_mae_dy": 0.019182145595550537,
      "pose_rmse_dtheta": 0.5458137392997742,
      "pose_rmse_dx": 0.2315371185541153,
      "pose_rmse_dy": 0.04625897482037544,
      "pose_rmse_mean": 0.2745366096496582,
      "rmse_dtheta": 0.058339592069387436,
      "rmse_dx": 0.02546682208776474,
      "rmse_dy": 0.00644645607098937,
      "rmse_mean": 0.030084289610385895,
      "rotation_flip": 0.014184396713972092,
      "sparse_tokens": 7679.0,
      "step": 6530,
      "turn_loss": 0.25082844495773315,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3034287307191972,
      "grad_norm": 0.5168142914772034,
      "learning_rate": 4.380155746312106e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.014370298944413662,
      "mae_dx": 0.002599801868200302,
      "mae_dy": 0.0038759249728173018,
      "pose_mae_dtheta": 0.09629421681165695,
      "pose_mae_dx": 0.035667434334754944,
      "pose_mae_dy": 0.03949500620365143,
      "pose_rmse_dtheta": 0.210663840174675,
      "pose_rmse_dx": 0.10807735472917557,
      "pose_rmse_dy": 0.07642222195863724,
      "pose_rmse_mean": 0.1317211389541626,
      "rmse_dtheta": 0.02708587981760502,
      "rmse_dx": 0.008219989016652107,
      "rmse_dy": 0.008085947483778,
      "rmse_mean": 0.014463938772678375,
      "rotation_flip": 0.007920792326331139,
      "sparse_tokens": 32089.0,
      "step": 6531,
      "turn_loss": 0.12065736949443817,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.30347519048503996,
      "grad_norm": 0.5672141313552856,
      "learning_rate": 4.378843748323082e-06,
      "loss": 0.1635,
      "mae_dtheta": 0.04822847247123718,
      "mae_dx": 0.014679133892059326,
      "mae_dy": 0.010180768556892872,
      "pose_mae_dtheta": 0.41270098090171814,
      "pose_mae_dx": 0.11105780303478241,
      "pose_mae_dy": 0.09556161612272263,
      "pose_rmse_dtheta": 0.6458094716072083,
      "pose_rmse_dx": 0.2264692485332489,
      "pose_rmse_dy": 0.22830446064472198,
      "pose_rmse_mean": 0.3668610751628876,
      "rmse_dtheta": 0.06752382963895798,
      "rmse_dx": 0.026574864983558655,
      "rmse_dy": 0.02183355949819088,
      "rmse_mean": 0.03864408656954765,
      "rotation_flip": 0.022847101092338562,
      "sparse_tokens": 18981.0,
      "step": 6532,
      "turn_loss": 0.4450487494468689,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.30352165025088274,
      "grad_norm": 0.4176976978778839,
      "learning_rate": 4.3775317937718465e-06,
      "loss": 0.1229,
      "mae_dtheta": 0.026265764608979225,
      "mae_dx": 0.00940042082220316,
      "mae_dy": 0.003969457466155291,
      "pose_mae_dtheta": 0.16252504289150238,
      "pose_mae_dx": 0.07403302192687988,
      "pose_mae_dy": 0.040496956557035446,
      "pose_rmse_dtheta": 0.3099643886089325,
      "pose_rmse_dx": 0.16425375640392303,
      "pose_rmse_dy": 0.09044599533081055,
      "pose_rmse_mean": 0.18822138011455536,
      "rmse_dtheta": 0.04372811317443848,
      "rmse_dx": 0.021162178367376328,
      "rmse_dy": 0.007482227869331837,
      "rmse_mean": 0.024124175310134888,
      "rotation_flip": 0.016591252759099007,
      "sparse_tokens": 12113.0,
      "step": 6533,
      "turn_loss": 0.218751922249794,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3035681100167255,
      "grad_norm": 0.5957760810852051,
      "learning_rate": 4.376219882750146e-06,
      "loss": 0.1806,
      "mae_dtheta": 0.009753796271979809,
      "mae_dx": 0.002189526567235589,
      "mae_dy": 0.003193188924342394,
      "pose_mae_dtheta": 0.07228557020425797,
      "pose_mae_dx": 0.022474225610494614,
      "pose_mae_dy": 0.03119076043367386,
      "pose_rmse_dtheta": 0.1648312658071518,
      "pose_rmse_dx": 0.06393961608409882,
      "pose_rmse_dy": 0.07047959417104721,
      "pose_rmse_mean": 0.09975016117095947,
      "rmse_dtheta": 0.02133236452937126,
      "rmse_dx": 0.007661823183298111,
      "rmse_dy": 0.008617700077593327,
      "rmse_mean": 0.012537295930087566,
      "rotation_flip": 0.003938730806112289,
      "sparse_tokens": 32073.0,
      "step": 6534,
      "turn_loss": 0.08455058932304382,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3036145697825683,
      "grad_norm": 0.6533880829811096,
      "learning_rate": 4.374908015349728e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.012435302138328552,
      "mae_dx": 0.002138934563845396,
      "mae_dy": 0.003221358871087432,
      "pose_mae_dtheta": 0.08665350824594498,
      "pose_mae_dx": 0.03117811121046543,
      "pose_mae_dy": 0.03924069181084633,
      "pose_rmse_dtheta": 0.20707762241363525,
      "pose_rmse_dx": 0.1024966761469841,
      "pose_rmse_dy": 0.11282049864530563,
      "pose_rmse_mean": 0.14079827070236206,
      "rmse_dtheta": 0.026034004986286163,
      "rmse_dx": 0.00704385619610548,
      "rmse_dy": 0.008705486543476582,
      "rmse_mean": 0.013927782885730267,
      "rotation_flip": 0.006062902510166168,
      "sparse_tokens": 32073.0,
      "step": 6535,
      "turn_loss": 0.1068122386932373,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30366102954841107,
      "grad_norm": 0.4148985743522644,
      "learning_rate": 4.373596191662324e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.007048791274428368,
      "mae_dx": 0.0009719963418319821,
      "mae_dy": 0.0017073809867724776,
      "pose_mae_dtheta": 0.04833286628127098,
      "pose_mae_dx": 0.014269468374550343,
      "pose_mae_dy": 0.020945152267813683,
      "pose_rmse_dtheta": 0.12941746413707733,
      "pose_rmse_dx": 0.03976576030254364,
      "pose_rmse_dy": 0.04960734769701958,
      "pose_rmse_mean": 0.07293019443750381,
      "rmse_dtheta": 0.01774527318775654,
      "rmse_dx": 0.002821152564138174,
      "rmse_dy": 0.003928684629499912,
      "rmse_mean": 0.008165037259459496,
      "rotation_flip": 0.00445831473916769,
      "sparse_tokens": 32089.0,
      "step": 6536,
      "turn_loss": 0.05489528179168701,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11344.0,
      "epoch": 0.30370748931425384,
      "grad_norm": 0.38993096351623535,
      "learning_rate": 4.3722844117796785e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.040169816464185715,
      "mae_dx": 0.014345907606184483,
      "mae_dy": 0.004645779728889465,
      "pose_mae_dtheta": 0.35981443524360657,
      "pose_mae_dx": 0.11335773020982742,
      "pose_mae_dy": 0.06101888790726662,
      "pose_rmse_dtheta": 0.6288071870803833,
      "pose_rmse_dx": 0.24936817586421967,
      "pose_rmse_dy": 0.15109960734844208,
      "pose_rmse_mean": 0.3430916666984558,
      "rmse_dtheta": 0.06042168661952019,
      "rmse_dx": 0.02801179699599743,
      "rmse_dy": 0.008335773833096027,
      "rmse_mean": 0.03225642070174217,
      "rotation_flip": 0.0191938579082489,
      "sparse_tokens": 9560.0,
      "step": 6537,
      "turn_loss": 0.30622243881225586,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3037539490800966,
      "grad_norm": 0.37227293848991394,
      "learning_rate": 4.370972675793517e-06,
      "loss": 0.086,
      "mae_dtheta": 0.0058630988933146,
      "mae_dx": 0.001867649145424366,
      "mae_dy": 0.000757956993766129,
      "pose_mae_dtheta": 0.04131479561328888,
      "pose_mae_dx": 0.016162704676389694,
      "pose_mae_dy": 0.010899888351559639,
      "pose_rmse_dtheta": 0.13770121335983276,
      "pose_rmse_dx": 0.06020231544971466,
      "pose_rmse_dy": 0.03595057502388954,
      "pose_rmse_mean": 0.07795137166976929,
      "rmse_dtheta": 0.018027598038315773,
      "rmse_dx": 0.006813456770032644,
      "rmse_dy": 0.002153868554159999,
      "rmse_mean": 0.008998308330774307,
      "rotation_flip": 0.002481389557942748,
      "sparse_tokens": 32089.0,
      "step": 6538,
      "turn_loss": 0.0447031669318676,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3038004088459394,
      "grad_norm": 0.4419715702533722,
      "learning_rate": 4.369660983795577e-06,
      "loss": 0.0855,
      "mae_dtheta": 0.01289950218051672,
      "mae_dx": 0.0018972083926200867,
      "mae_dy": 0.003228121669963002,
      "pose_mae_dtheta": 0.08385476469993591,
      "pose_mae_dx": 0.029232146218419075,
      "pose_mae_dy": 0.0346769280731678,
      "pose_rmse_dtheta": 0.19353114068508148,
      "pose_rmse_dx": 0.08171983808279037,
      "pose_rmse_dy": 0.08579117059707642,
      "pose_rmse_mean": 0.12034738063812256,
      "rmse_dtheta": 0.026001203805208206,
      "rmse_dx": 0.005501868203282356,
      "rmse_dy": 0.008244788274168968,
      "rmse_mean": 0.013249288313090801,
      "rotation_flip": 0.006242684554308653,
      "sparse_tokens": 32073.0,
      "step": 6539,
      "turn_loss": 0.09769106656312943,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3038468686117822,
      "grad_norm": 0.5009217262268066,
      "learning_rate": 4.3683493358775804e-06,
      "loss": 0.144,
      "mae_dtheta": 0.006782305892556906,
      "mae_dx": 0.0010183854028582573,
      "mae_dy": 0.0012181312777101994,
      "pose_mae_dtheta": 0.04704747721552849,
      "pose_mae_dx": 0.012143708765506744,
      "pose_mae_dy": 0.015657298266887665,
      "pose_rmse_dtheta": 0.1621152013540268,
      "pose_rmse_dx": 0.027605844661593437,
      "pose_rmse_dy": 0.038816675543785095,
      "pose_rmse_mean": 0.07617924362421036,
      "rmse_dtheta": 0.018417026847600937,
      "rmse_dx": 0.0031366562470793724,
      "rmse_dy": 0.002725267317146063,
      "rmse_mean": 0.008092984557151794,
      "rotation_flip": 0.0012626262614503503,
      "sparse_tokens": 32137.0,
      "step": 6540,
      "turn_loss": 0.052811797708272934,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.30389332837762495,
      "grad_norm": 0.7527549266815186,
      "learning_rate": 4.367037732131254e-06,
      "loss": 0.1404,
      "mae_dtheta": 0.030024589970707893,
      "mae_dx": 0.010758995078504086,
      "mae_dy": 0.004901257809251547,
      "pose_mae_dtheta": 0.23086072504520416,
      "pose_mae_dx": 0.09402456879615784,
      "pose_mae_dy": 0.04850440472364426,
      "pose_rmse_dtheta": 0.4272179901599884,
      "pose_rmse_dx": 0.23051267862319946,
      "pose_rmse_dy": 0.10118252784013748,
      "pose_rmse_mean": 0.2529710829257965,
      "rmse_dtheta": 0.048489660024642944,
      "rmse_dx": 0.024414801970124245,
      "rmse_dy": 0.009706217795610428,
      "rmse_mean": 0.027536895126104355,
      "rotation_flip": 0.01765650138258934,
      "sparse_tokens": 13369.0,
      "step": 6541,
      "turn_loss": 0.22357380390167236,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3039397881434678,
      "grad_norm": 0.34228038787841797,
      "learning_rate": 4.36572617264832e-06,
      "loss": 0.069,
      "mae_dtheta": 0.00622224947437644,
      "mae_dx": 0.0008789999410510063,
      "mae_dy": 0.0016525044338777661,
      "pose_mae_dtheta": 0.03935366868972778,
      "pose_mae_dx": 0.01585795171558857,
      "pose_mae_dy": 0.021144337952136993,
      "pose_rmse_dtheta": 0.08722006529569626,
      "pose_rmse_dx": 0.04446016624569893,
      "pose_rmse_dy": 0.05383383482694626,
      "pose_rmse_mean": 0.061838023364543915,
      "rmse_dtheta": 0.014786860905587673,
      "rmse_dx": 0.0023891557939350605,
      "rmse_dy": 0.003824288258329034,
      "rmse_mean": 0.00700010173022747,
      "rotation_flip": 0.0027409775648266077,
      "sparse_tokens": 32057.0,
      "step": 6542,
      "turn_loss": 0.05641089379787445,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30398624790931056,
      "grad_norm": 0.5488663911819458,
      "learning_rate": 4.3644146575204935e-06,
      "loss": 0.1817,
      "mae_dtheta": 0.005378217902034521,
      "mae_dx": 0.001344987889751792,
      "mae_dy": 0.0007719823624938726,
      "pose_mae_dtheta": 0.04144878312945366,
      "pose_mae_dx": 0.012936320155858994,
      "pose_mae_dy": 0.014805666171014309,
      "pose_rmse_dtheta": 0.12172245234251022,
      "pose_rmse_dx": 0.03959900140762329,
      "pose_rmse_dy": 0.05031372606754303,
      "pose_rmse_mean": 0.07054506242275238,
      "rmse_dtheta": 0.015522820875048637,
      "rmse_dx": 0.004541079979389906,
      "rmse_dy": 0.0020408572163432837,
      "rmse_mean": 0.007368253078311682,
      "rotation_flip": 0.002425222424790263,
      "sparse_tokens": 32089.0,
      "step": 6543,
      "turn_loss": 0.0462946742773056,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.30403270767515334,
      "grad_norm": 0.5606786012649536,
      "learning_rate": 4.363103186839494e-06,
      "loss": 0.1099,
      "mae_dtheta": 0.006746097933501005,
      "mae_dx": 0.001807704451493919,
      "mae_dy": 0.0017957149539142847,
      "pose_mae_dtheta": 0.04888707399368286,
      "pose_mae_dx": 0.016767239198088646,
      "pose_mae_dy": 0.019238939508795738,
      "pose_rmse_dtheta": 0.14154064655303955,
      "pose_rmse_dx": 0.057708363980054855,
      "pose_rmse_dy": 0.06182880699634552,
      "pose_rmse_mean": 0.08702594041824341,
      "rmse_dtheta": 0.018283754587173462,
      "rmse_dx": 0.006864569615572691,
      "rmse_dy": 0.005625939927995205,
      "rmse_mean": 0.010258088819682598,
      "rotation_flip": 0.004548038821667433,
      "sparse_tokens": 32041.0,
      "step": 6544,
      "turn_loss": 0.05999663472175598,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.3040791674409961,
      "grad_norm": 0.6113764047622681,
      "learning_rate": 4.361791760697027e-06,
      "loss": 0.1599,
      "mae_dtheta": 0.03746110200881958,
      "mae_dx": 0.007371635641902685,
      "mae_dy": 0.004045534413307905,
      "pose_mae_dtheta": 0.3132026791572571,
      "pose_mae_dx": 0.06401170790195465,
      "pose_mae_dy": 0.0479310117661953,
      "pose_rmse_dtheta": 0.5380504131317139,
      "pose_rmse_dx": 0.13298365473747253,
      "pose_rmse_dy": 0.10910717397928238,
      "pose_rmse_mean": 0.2600471079349518,
      "rmse_dtheta": 0.05836394801735878,
      "rmse_dx": 0.016318246722221375,
      "rmse_dy": 0.008869814686477184,
      "rmse_mean": 0.027850668877363205,
      "rotation_flip": 0.011787819676101208,
      "sparse_tokens": 8495.0,
      "step": 6545,
      "turn_loss": 0.28964585065841675,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3041256272068389,
      "grad_norm": 0.6449587345123291,
      "learning_rate": 4.360480379184807e-06,
      "loss": 0.173,
      "mae_dtheta": 0.006564691197127104,
      "mae_dx": 0.0014009613078087568,
      "mae_dy": 0.0016145980916917324,
      "pose_mae_dtheta": 0.04334603622555733,
      "pose_mae_dx": 0.01292857900261879,
      "pose_mae_dy": 0.018442191183567047,
      "pose_rmse_dtheta": 0.11525329202413559,
      "pose_rmse_dx": 0.036574430763721466,
      "pose_rmse_dy": 0.047767914831638336,
      "pose_rmse_mean": 0.06653188169002533,
      "rmse_dtheta": 0.01568439230322838,
      "rmse_dx": 0.004722860641777515,
      "rmse_dy": 0.004416698589920998,
      "rmse_mean": 0.008274650201201439,
      "rotation_flip": 0.00563834048807621,
      "sparse_tokens": 32137.0,
      "step": 6546,
      "turn_loss": 0.05634728819131851,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35254.0,
      "epoch": 0.30417208697268167,
      "grad_norm": 0.5089985728263855,
      "learning_rate": 4.359169042394537e-06,
      "loss": 0.1323,
      "mae_dtheta": 0.0327918641269207,
      "mae_dx": 0.012972775846719742,
      "mae_dy": 0.007989844307303429,
      "pose_mae_dtheta": 0.28583648800849915,
      "pose_mae_dx": 0.10741857439279556,
      "pose_mae_dy": 0.0795757994055748,
      "pose_rmse_dtheta": 0.514464795589447,
      "pose_rmse_dx": 0.25437986850738525,
      "pose_rmse_dy": 0.20111261308193207,
      "pose_rmse_mean": 0.32331910729408264,
      "rmse_dtheta": 0.05282151326537132,
      "rmse_dx": 0.025738900527358055,
      "rmse_dy": 0.01938766799867153,
      "rmse_mean": 0.032649360597133636,
      "rotation_flip": 0.016558675095438957,
      "sparse_tokens": 27582.0,
      "step": 6547,
      "turn_loss": 0.3285640776157379,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.30421854673852444,
      "grad_norm": 0.39506813883781433,
      "learning_rate": 4.357857750417919e-06,
      "loss": 0.0843,
      "mae_dtheta": 0.008478168398141861,
      "mae_dx": 0.0021845796145498753,
      "mae_dy": 0.003233620896935463,
      "pose_mae_dtheta": 0.05583328753709793,
      "pose_mae_dx": 0.029204843565821648,
      "pose_mae_dy": 0.03184464946389198,
      "pose_rmse_dtheta": 0.10653331130743027,
      "pose_rmse_dx": 0.09606480598449707,
      "pose_rmse_dy": 0.07093491405248642,
      "pose_rmse_mean": 0.09117768704891205,
      "rmse_dtheta": 0.017000289633870125,
      "rmse_dx": 0.006633262149989605,
      "rmse_dy": 0.007763864938169718,
      "rmse_mean": 0.010465806350111961,
      "rotation_flip": 0.005103901028633118,
      "sparse_tokens": 32105.0,
      "step": 6548,
      "turn_loss": 0.08914171159267426,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.3042650065043672,
      "grad_norm": 0.8001036047935486,
      "learning_rate": 4.356546503346655e-06,
      "loss": 0.2834,
      "mae_dtheta": 0.04308009520173073,
      "mae_dx": 0.012481320649385452,
      "mae_dy": 0.007927827537059784,
      "pose_mae_dtheta": 0.3416315019130707,
      "pose_mae_dx": 0.09238462895154953,
      "pose_mae_dy": 0.06661749631166458,
      "pose_rmse_dtheta": 0.5700628161430359,
      "pose_rmse_dx": 0.20852147042751312,
      "pose_rmse_dy": 0.14551742374897003,
      "pose_rmse_mean": 0.30803391337394714,
      "rmse_dtheta": 0.062174391001462936,
      "rmse_dx": 0.02437763288617134,
      "rmse_dy": 0.017118871212005615,
      "rmse_mean": 0.03455696627497673,
      "rotation_flip": 0.010426539927721024,
      "sparse_tokens": 17025.0,
      "step": 6549,
      "turn_loss": 0.34778663516044617,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.30431146627021,
      "grad_norm": 0.5009194612503052,
      "learning_rate": 4.3552353012724374e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.05316414311528206,
      "mae_dx": 0.02610798552632332,
      "mae_dy": 0.0193598922342062,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5009194016456604,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 122.07733917236328,
      "model/head/act_norm_mean": 95.26627807617187,
      "model/head/act_norm_min": 82.77567291259766,
      "model/head/act_over_embed": 65.46787819089272,
      "model/head/grad_frac": 0.09416621178388596,
      "model/head/grad_norm": 0.04716968163847923,
      "model/head/grad_zero_frac": 0.00016910585691221058,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.69306640625,
      "model/head/update_ratio": 0.0008050833130255342,
      "model/head/weight_delta": 9.200331687927246,
      "model/head/weight_delta_rel": 0.16140106320381165,
      "model/head/weight_norm": 58.589813232421875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4213930368423462,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4213930368423462,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4213930368423462,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28958524006182795,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11216036230325699,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05618330091238022,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0018153248820453882,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9732370376586914,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09714492410421371,
      "model/modality_embedder.encoders.pose/weight_norm": 30.949447631835938,
      "model/modality_embedder/grad_frac": 0.11216036230325699,
      "model/modality_embedder/grad_norm": 0.05618330091238022,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0018153248820453882,
      "model/modality_embedder/weight_delta": 2.9732370376586914,
      "model/modality_embedder/weight_delta_rel": 0.09714492410421371,
      "model/modality_embedder/weight_norm": 30.949447631835938,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 58.127777099609375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.767520771329366,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.719297409057617,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.64605342694528,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.061349667608737946,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.030731238424777985,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011021314421668649,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.384582757949829,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08689563721418381,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.883460998535156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 59.794654846191406,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.569838169642857,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 13.2125825881958,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.197413454480138,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06459213048219681,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.032355450093746185,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010915249586105347,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.022874593734741,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10471473634243011,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.642427444458008,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 61.879825592041016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.180482700892856,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.491175651550293,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.304263455446815,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06876429170370102,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03444536775350571,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011254892451688647,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.2601184844970703,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10946867614984512,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.604795455932617,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 63.22985076904297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.363501364087302,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.379036903381348,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.804454318536763,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07516571879386902,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.037651967257261276,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012612855061888695,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.788417100906372,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09529486298561096,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.8520565032959,
      "model/normalizer/grad_frac": 0.29233548045158386,
      "model/normalizer/grad_norm": 0.14643651247024536,
      "model/normalizer/grad_zero_frac": 0.00022571203589905053,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018651026766747236,
      "model/normalizer/weight_delta": 5.898517608642578,
      "model/normalizer/weight_delta_rel": 0.07596949487924576,
      "model/normalizer/weight_norm": 78.513916015625,
      "pose_mae_dtheta": 0.5320312976837158,
      "pose_mae_dx": 0.18699045479297638,
      "pose_mae_dy": 0.12077038735151291,
      "pose_rmse_dtheta": 0.8510619401931763,
      "pose_rmse_dx": 0.32156527042388916,
      "pose_rmse_dy": 0.2604776620864868,
      "pose_rmse_mean": 0.4777016341686249,
      "rmse_dtheta": 0.08105659484863281,
      "rmse_dx": 0.045319996774196625,
      "rmse_dy": 0.036241449415683746,
      "rmse_mean": 0.054206013679504395,
      "rotation_flip": 0.0,
      "sparse_tokens": 2791.0,
      "step": 6550,
      "turn_loss": 0.8682301640510559,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.3043579260360528,
      "grad_norm": 0.7120203971862793,
      "learning_rate": 4.353924144286963e-06,
      "loss": 0.1506,
      "mae_dtheta": 0.03092838078737259,
      "mae_dx": 0.007333988323807716,
      "mae_dy": 0.006556726060807705,
      "pose_mae_dtheta": 0.24764399230480194,
      "pose_mae_dx": 0.05904217064380646,
      "pose_mae_dy": 0.05802805721759796,
      "pose_rmse_dtheta": 0.4695551097393036,
      "pose_rmse_dx": 0.155340775847435,
      "pose_rmse_dy": 0.13677439093589783,
      "pose_rmse_mean": 0.25389009714126587,
      "rmse_dtheta": 0.05193476378917694,
      "rmse_dx": 0.017738310620188713,
      "rmse_dy": 0.016267597675323486,
      "rmse_mean": 0.028646891936659813,
      "rotation_flip": 0.01433691754937172,
      "sparse_tokens": 10159.0,
      "step": 6551,
      "turn_loss": 0.24806459248065948,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 28786.0,
      "epoch": 0.30440438580189555,
      "grad_norm": 0.564976155757904,
      "learning_rate": 4.352613032481918e-06,
      "loss": 0.1672,
      "mae_dtheta": 0.028756702318787575,
      "mae_dx": 0.011023782193660736,
      "mae_dy": 0.0037923248019069433,
      "pose_mae_dtheta": 0.23031340539455414,
      "pose_mae_dx": 0.08603645116090775,
      "pose_mae_dy": 0.04432074725627899,
      "pose_rmse_dtheta": 0.4435398280620575,
      "pose_rmse_dx": 0.20171578228473663,
      "pose_rmse_dy": 0.11029788851737976,
      "pose_rmse_mean": 0.2518511712551117,
      "rmse_dtheta": 0.04705149307847023,
      "rmse_dx": 0.02360120788216591,
      "rmse_dy": 0.007346265017986298,
      "rmse_mean": 0.025999655947089195,
      "rotation_flip": 0.016188373789191246,
      "sparse_tokens": 22541.0,
      "step": 6552,
      "turn_loss": 0.19343331456184387,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.3044508455677383,
      "grad_norm": 0.4754314422607422,
      "learning_rate": 4.3513019659489916e-06,
      "loss": 0.119,
      "mae_dtheta": 0.04356775060296059,
      "mae_dx": 0.015090394765138626,
      "mae_dy": 0.009924029000103474,
      "pose_mae_dtheta": 0.3331166207790375,
      "pose_mae_dx": 0.12421844154596329,
      "pose_mae_dy": 0.10938014835119247,
      "pose_rmse_dtheta": 0.5059670209884644,
      "pose_rmse_dx": 0.2446073591709137,
      "pose_rmse_dy": 0.22571513056755066,
      "pose_rmse_mean": 0.32542985677719116,
      "rmse_dtheta": 0.05949287861585617,
      "rmse_dx": 0.027356410399079323,
      "rmse_dy": 0.019233979284763336,
      "rmse_mean": 0.03536108881235123,
      "rotation_flip": 0.01666666753590107,
      "sparse_tokens": 14413.0,
      "step": 6553,
      "turn_loss": 0.4257749319076538,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3044973053335811,
      "grad_norm": 0.443150132894516,
      "learning_rate": 4.349990944779868e-06,
      "loss": 0.0696,
      "mae_dtheta": 0.0066610900685191154,
      "mae_dx": 0.0009853732772171497,
      "mae_dy": 0.0008984473533928394,
      "pose_mae_dtheta": 0.045594073832035065,
      "pose_mae_dx": 0.012521976605057716,
      "pose_mae_dy": 0.012700715102255344,
      "pose_rmse_dtheta": 0.18522271513938904,
      "pose_rmse_dx": 0.040692903101444244,
      "pose_rmse_dy": 0.04124976322054863,
      "pose_rmse_mean": 0.0890551209449768,
      "rmse_dtheta": 0.02339179627597332,
      "rmse_dx": 0.0030611553229391575,
      "rmse_dy": 0.002977467607706785,
      "rmse_mean": 0.00981014035642147,
      "rotation_flip": 0.0018587360391393304,
      "sparse_tokens": 32105.0,
      "step": 6554,
      "turn_loss": 0.0407804474234581,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3045437650994239,
      "grad_norm": 0.5323753356933594,
      "learning_rate": 4.348679969066225e-06,
      "loss": 0.1442,
      "mae_dtheta": 0.009044406935572624,
      "mae_dx": 0.0015322818653658032,
      "mae_dy": 0.002059793099761009,
      "pose_mae_dtheta": 0.061782125383615494,
      "pose_mae_dx": 0.02029591053724289,
      "pose_mae_dy": 0.024987302720546722,
      "pose_rmse_dtheta": 0.1487932801246643,
      "pose_rmse_dx": 0.06092078611254692,
      "pose_rmse_dy": 0.06447386741638184,
      "pose_rmse_mean": 0.09139597415924072,
      "rmse_dtheta": 0.020025165751576424,
      "rmse_dx": 0.005573873408138752,
      "rmse_dy": 0.004653905052691698,
      "rmse_mean": 0.010084315203130245,
      "rotation_flip": 0.00729631120339036,
      "sparse_tokens": 32089.0,
      "step": 6555,
      "turn_loss": 0.0666738748550415,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.30459022486526666,
      "grad_norm": 0.5819382071495056,
      "learning_rate": 4.347369038899744e-06,
      "loss": 0.1296,
      "mae_dtheta": 0.025960318744182587,
      "mae_dx": 0.009869290515780449,
      "mae_dy": 0.0034429803490638733,
      "pose_mae_dtheta": 0.19363431632518768,
      "pose_mae_dx": 0.08136124163866043,
      "pose_mae_dy": 0.0510856918990612,
      "pose_rmse_dtheta": 0.3685551881790161,
      "pose_rmse_dx": 0.21125714480876923,
      "pose_rmse_dy": 0.11447769403457642,
      "pose_rmse_mean": 0.2314300239086151,
      "rmse_dtheta": 0.04249138385057449,
      "rmse_dx": 0.02325136959552765,
      "rmse_dy": 0.00656987214460969,
      "rmse_mean": 0.024104207754135132,
      "rotation_flip": 0.00671140942722559,
      "sparse_tokens": 17002.0,
      "step": 6556,
      "turn_loss": 0.17831802368164062,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.30463668463110943,
      "grad_norm": 0.7749198079109192,
      "learning_rate": 4.346058154372093e-06,
      "loss": 0.141,
      "mae_dtheta": 0.029253575950860977,
      "mae_dx": 0.012855284847319126,
      "mae_dy": 0.008627611212432384,
      "pose_mae_dtheta": 0.2795221209526062,
      "pose_mae_dx": 0.06437313556671143,
      "pose_mae_dy": 0.12386057525873184,
      "pose_rmse_dtheta": 0.5560922026634216,
      "pose_rmse_dx": 0.10964497923851013,
      "pose_rmse_dy": 0.25349920988082886,
      "pose_rmse_mean": 0.30641213059425354,
      "rmse_dtheta": 0.048656120896339417,
      "rmse_dx": 0.024069804698228836,
      "rmse_dy": 0.013294328935444355,
      "rmse_mean": 0.02867341786623001,
      "rotation_flip": 0.0,
      "sparse_tokens": 3129.0,
      "step": 6557,
      "turn_loss": 0.28367945551872253,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.30468314439695227,
      "grad_norm": 0.5087870955467224,
      "learning_rate": 4.344747315574949e-06,
      "loss": 0.0843,
      "mae_dtheta": 0.008441582322120667,
      "mae_dx": 0.0013703281292691827,
      "mae_dy": 0.0021881680004298687,
      "pose_mae_dtheta": 0.05441046506166458,
      "pose_mae_dx": 0.018337680026888847,
      "pose_mae_dy": 0.022601209580898285,
      "pose_rmse_dtheta": 0.14058978855609894,
      "pose_rmse_dx": 0.044164303690195084,
      "pose_rmse_dy": 0.05352937430143356,
      "pose_rmse_mean": 0.0794278234243393,
      "rmse_dtheta": 0.019641298800706863,
      "rmse_dx": 0.00407841382548213,
      "rmse_dy": 0.005036493297666311,
      "rmse_mean": 0.00958540290594101,
      "rotation_flip": 0.0015449980273842812,
      "sparse_tokens": 32121.0,
      "step": 6558,
      "turn_loss": 0.06669847667217255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.30472960416279504,
      "grad_norm": 0.549942672252655,
      "learning_rate": 4.343436522599975e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.006694606505334377,
      "mae_dx": 0.0019674249924719334,
      "mae_dy": 0.0015858265105634928,
      "pose_mae_dtheta": 0.04119914025068283,
      "pose_mae_dx": 0.017500389367341995,
      "pose_mae_dy": 0.017233218997716904,
      "pose_rmse_dtheta": 0.12168369442224503,
      "pose_rmse_dx": 0.0490327924489975,
      "pose_rmse_dy": 0.05015238747000694,
      "pose_rmse_mean": 0.07362296432256699,
      "rmse_dtheta": 0.018236473202705383,
      "rmse_dx": 0.0057324911467731,
      "rmse_dy": 0.004525340162217617,
      "rmse_mean": 0.009498102590441704,
      "rotation_flip": 0.004426955245435238,
      "sparse_tokens": 32121.0,
      "step": 6559,
      "turn_loss": 0.07240784168243408,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3047760639286378,
      "grad_norm": 0.44800058007240295,
      "learning_rate": 4.342125775538837e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.010790828615427017,
      "mae_dx": 0.002654975512996316,
      "mae_dy": 0.0028410821687430143,
      "pose_mae_dtheta": 0.06900503486394882,
      "pose_mae_dx": 0.03207778185606003,
      "pose_mae_dy": 0.030393093824386597,
      "pose_rmse_dtheta": 0.17342627048492432,
      "pose_rmse_dx": 0.09756764024496078,
      "pose_rmse_dy": 0.06899786740541458,
      "pose_rmse_mean": 0.11333059519529343,
      "rmse_dtheta": 0.022172173485159874,
      "rmse_dx": 0.008370726369321346,
      "rmse_dy": 0.006731748580932617,
      "rmse_mean": 0.012424882501363754,
      "rotation_flip": 0.004181184805929661,
      "sparse_tokens": 32089.0,
      "step": 6560,
      "turn_loss": 0.1201530247926712,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.3048225236944806,
      "grad_norm": 0.6972980499267578,
      "learning_rate": 4.340815074483199e-06,
      "loss": 0.1542,
      "mae_dtheta": 0.025965236127376556,
      "mae_dx": 0.009106560610234737,
      "mae_dy": 0.003377078101038933,
      "pose_mae_dtheta": 0.19476978480815887,
      "pose_mae_dx": 0.07295200973749161,
      "pose_mae_dy": 0.04014270752668381,
      "pose_rmse_dtheta": 0.35878878831863403,
      "pose_rmse_dx": 0.1739863157272339,
      "pose_rmse_dy": 0.11436368525028229,
      "pose_rmse_mean": 0.21571293473243713,
      "rmse_dtheta": 0.04348103329539299,
      "rmse_dx": 0.02038472332060337,
      "rmse_dy": 0.008043115958571434,
      "rmse_mean": 0.023969626054167747,
      "rotation_flip": 0.010084033943712711,
      "sparse_tokens": 11084.0,
      "step": 6561,
      "turn_loss": 0.21164865791797638,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3048689834603234,
      "grad_norm": 0.4856868088245392,
      "learning_rate": 4.339504419524715e-06,
      "loss": 0.0795,
      "mae_dtheta": 0.0080605773255229,
      "mae_dx": 0.001687153009697795,
      "mae_dy": 0.0023741964250802994,
      "pose_mae_dtheta": 0.05674978718161583,
      "pose_mae_dx": 0.02342013455927372,
      "pose_mae_dy": 0.02714451588690281,
      "pose_rmse_dtheta": 0.12811847031116486,
      "pose_rmse_dx": 0.06639516353607178,
      "pose_rmse_dy": 0.0730823278427124,
      "pose_rmse_mean": 0.08919864892959595,
      "rmse_dtheta": 0.017562249675393105,
      "rmse_dx": 0.004684341140091419,
      "rmse_dy": 0.005627650301903486,
      "rmse_mean": 0.00929141417145729,
      "rotation_flip": 0.004189944360405207,
      "sparse_tokens": 32105.0,
      "step": 6562,
      "turn_loss": 0.07475268840789795,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 41734.0,
      "epoch": 0.30491544322616615,
      "grad_norm": 0.6395881772041321,
      "learning_rate": 4.338193810755042e-06,
      "loss": 0.1834,
      "mae_dtheta": 0.04103666916489601,
      "mae_dx": 0.014066225849092007,
      "mae_dy": 0.004293744917958975,
      "pose_mae_dtheta": 0.34164220094680786,
      "pose_mae_dx": 0.10230253636837006,
      "pose_mae_dy": 0.05486774444580078,
      "pose_rmse_dtheta": 0.5726714134216309,
      "pose_rmse_dx": 0.2323458343744278,
      "pose_rmse_dy": 0.13582929968833923,
      "pose_rmse_mean": 0.3136155307292938,
      "rmse_dtheta": 0.059212952852249146,
      "rmse_dx": 0.027182897552847862,
      "rmse_dy": 0.008570732548832893,
      "rmse_mean": 0.03165552765130997,
      "rotation_flip": 0.01488569937646389,
      "sparse_tokens": 30034.0,
      "step": 6563,
      "turn_loss": 0.28685951232910156,
      "turns": 129.0,
      "turns_per_sample": 129.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.3049619029920089,
      "grad_norm": 0.642518937587738,
      "learning_rate": 4.3368832482658304e-06,
      "loss": 0.156,
      "mae_dtheta": 0.022263994440436363,
      "mae_dx": 0.01090963650494814,
      "mae_dy": 0.005137708503752947,
      "pose_mae_dtheta": 0.19544146955013275,
      "pose_mae_dx": 0.09130433201789856,
      "pose_mae_dy": 0.05793067440390587,
      "pose_rmse_dtheta": 0.31746912002563477,
      "pose_rmse_dx": 0.18120524287223816,
      "pose_rmse_dy": 0.11053979396820068,
      "pose_rmse_mean": 0.20307140052318573,
      "rmse_dtheta": 0.033330418169498444,
      "rmse_dx": 0.021035414189100266,
      "rmse_dy": 0.0076247211545705795,
      "rmse_mean": 0.020663518458604813,
      "rotation_flip": 0.0061349691823124886,
      "sparse_tokens": 3105.0,
      "step": 6564,
      "turn_loss": 0.2338063269853592,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3050083627578517,
      "grad_norm": 0.39548343420028687,
      "learning_rate": 4.33557273214873e-06,
      "loss": 0.0801,
      "mae_dtheta": 0.009630214422941208,
      "mae_dx": 0.0012443081941455603,
      "mae_dy": 0.0017295959405601025,
      "pose_mae_dtheta": 0.06414751708507538,
      "pose_mae_dx": 0.018484991043806076,
      "pose_mae_dy": 0.028016934171319008,
      "pose_rmse_dtheta": 0.16566269099712372,
      "pose_rmse_dx": 0.047369297593832016,
      "pose_rmse_dy": 0.05959634482860565,
      "pose_rmse_mean": 0.09087611734867096,
      "rmse_dtheta": 0.01953910104930401,
      "rmse_dx": 0.00429950188845396,
      "rmse_dy": 0.0034406310878694057,
      "rmse_mean": 0.009093077853322029,
      "rotation_flip": 0.0048273298889398575,
      "sparse_tokens": 32073.0,
      "step": 6565,
      "turn_loss": 0.07468074560165405,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.3050548225236945,
      "grad_norm": 0.40769752860069275,
      "learning_rate": 4.334262262495385e-06,
      "loss": 0.085,
      "mae_dtheta": 0.023200232535600662,
      "mae_dx": 0.009860617108643055,
      "mae_dy": 0.0045540668070316315,
      "pose_mae_dtheta": 0.15822425484657288,
      "pose_mae_dx": 0.0753672644495964,
      "pose_mae_dy": 0.06525255739688873,
      "pose_rmse_dtheta": 0.29433584213256836,
      "pose_rmse_dx": 0.17732319235801697,
      "pose_rmse_dy": 0.15862633287906647,
      "pose_rmse_mean": 0.2100951373577118,
      "rmse_dtheta": 0.0400761216878891,
      "rmse_dx": 0.023388955742120743,
      "rmse_dy": 0.008739259093999863,
      "rmse_mean": 0.024068113416433334,
      "rotation_flip": 0.013029315508902073,
      "sparse_tokens": 12922.0,
      "step": 6566,
      "turn_loss": 0.23817099630832672,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.30510128228953726,
      "grad_norm": 0.4579382538795471,
      "learning_rate": 4.3329518393974365e-06,
      "loss": 0.1161,
      "mae_dtheta": 0.011551577597856522,
      "mae_dx": 0.0016156454803422093,
      "mae_dy": 0.0025633706245571375,
      "pose_mae_dtheta": 0.07634542137384415,
      "pose_mae_dx": 0.020243369042873383,
      "pose_mae_dy": 0.03213060647249222,
      "pose_rmse_dtheta": 0.19651168584823608,
      "pose_rmse_dx": 0.04927351325750351,
      "pose_rmse_dy": 0.06929928064346313,
      "pose_rmse_mean": 0.1050281673669815,
      "rmse_dtheta": 0.024037564173340797,
      "rmse_dx": 0.005097130313515663,
      "rmse_dy": 0.005651642102748156,
      "rmse_mean": 0.011595445685088634,
      "rotation_flip": 0.006188569124788046,
      "sparse_tokens": 32073.0,
      "step": 6567,
      "turn_loss": 0.09270036220550537,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.30514774205538003,
      "grad_norm": 0.8168203830718994,
      "learning_rate": 4.331641462946526e-06,
      "loss": 0.1002,
      "mae_dtheta": 0.031587567180395126,
      "mae_dx": 0.009114922024309635,
      "mae_dy": 0.003902010153979063,
      "pose_mae_dtheta": 0.25691714882850647,
      "pose_mae_dx": 0.062177326530218124,
      "pose_mae_dy": 0.044461846351623535,
      "pose_rmse_dtheta": 0.45187172293663025,
      "pose_rmse_dx": 0.13886232674121857,
      "pose_rmse_dy": 0.09408456832170486,
      "pose_rmse_mean": 0.22827288508415222,
      "rmse_dtheta": 0.048547178506851196,
      "rmse_dx": 0.018693791702389717,
      "rmse_dy": 0.008737903088331223,
      "rmse_mean": 0.02532629296183586,
      "rotation_flip": 0.033426184207201004,
      "sparse_tokens": 6512.0,
      "step": 6568,
      "turn_loss": 0.2676810026168823,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.3051942018212228,
      "grad_norm": 0.7654042840003967,
      "learning_rate": 4.330331133234284e-06,
      "loss": 0.1824,
      "mae_dtheta": 0.03502415120601654,
      "mae_dx": 0.012771089561283588,
      "mae_dy": 0.0059167733415961266,
      "pose_mae_dtheta": 0.28657737374305725,
      "pose_mae_dx": 0.09732139855623245,
      "pose_mae_dy": 0.06212352216243744,
      "pose_rmse_dtheta": 0.5240380764007568,
      "pose_rmse_dx": 0.2083519846200943,
      "pose_rmse_dy": 0.14518319070339203,
      "pose_rmse_mean": 0.29252442717552185,
      "rmse_dtheta": 0.0527324341237545,
      "rmse_dx": 0.02516544796526432,
      "rmse_dy": 0.011001468636095524,
      "rmse_mean": 0.029633117839694023,
      "rotation_flip": 0.010989011265337467,
      "sparse_tokens": 7736.0,
      "step": 6569,
      "turn_loss": 0.2667125165462494,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.3052406615870656,
      "grad_norm": 0.7423580884933472,
      "learning_rate": 4.3290208503523475e-06,
      "loss": 0.1381,
      "mae_dtheta": 0.02747231535613537,
      "mae_dx": 0.006200460251420736,
      "mae_dy": 0.0032640942372381687,
      "pose_mae_dtheta": 0.19619454443454742,
      "pose_mae_dx": 0.04228179529309273,
      "pose_mae_dy": 0.03454528748989105,
      "pose_rmse_dtheta": 0.41277486085891724,
      "pose_rmse_dx": 0.14356955885887146,
      "pose_rmse_dy": 0.07012006640434265,
      "pose_rmse_mean": 0.20882150530815125,
      "rmse_dtheta": 0.04580621048808098,
      "rmse_dx": 0.016475772485136986,
      "rmse_dy": 0.005972718354314566,
      "rmse_mean": 0.022751567885279655,
      "rotation_flip": 0.004830917809158564,
      "sparse_tokens": 7170.0,
      "step": 6570,
      "turn_loss": 0.17415067553520203,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.30528712135290836,
      "grad_norm": 0.4198833405971527,
      "learning_rate": 4.327710614392341e-06,
      "loss": 0.1295,
      "mae_dtheta": 0.011932622641324997,
      "mae_dx": 0.0027882461436092854,
      "mae_dy": 0.0028338569682091475,
      "pose_mae_dtheta": 0.09327234327793121,
      "pose_mae_dx": 0.02731846459209919,
      "pose_mae_dy": 0.027925290167331696,
      "pose_rmse_dtheta": 0.23334182798862457,
      "pose_rmse_dx": 0.08651097863912582,
      "pose_rmse_dy": 0.06101550534367561,
      "pose_rmse_mean": 0.12695610523223877,
      "rmse_dtheta": 0.026861194521188736,
      "rmse_dx": 0.009047369472682476,
      "rmse_dy": 0.007192397955805063,
      "rmse_mean": 0.014366988092660904,
      "rotation_flip": 0.005309063475579023,
      "sparse_tokens": 32137.0,
      "step": 6571,
      "turn_loss": 0.12169716507196426,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.30533358111875114,
      "grad_norm": 0.550582230091095,
      "learning_rate": 4.3264004254458925e-06,
      "loss": 0.1185,
      "mae_dtheta": 0.033385030925273895,
      "mae_dx": 0.009833051823079586,
      "mae_dy": 0.0035769096575677395,
      "pose_mae_dtheta": 0.2596845030784607,
      "pose_mae_dx": 0.0753830298781395,
      "pose_mae_dy": 0.03618185594677925,
      "pose_rmse_dtheta": 0.47851258516311646,
      "pose_rmse_dx": 0.17536108195781708,
      "pose_rmse_dy": 0.07063545286655426,
      "pose_rmse_mean": 0.241503044962883,
      "rmse_dtheta": 0.05153513699769974,
      "rmse_dx": 0.020368067547678947,
      "rmse_dy": 0.006659964099526405,
      "rmse_mean": 0.026187723502516747,
      "rotation_flip": 0.019851116463541985,
      "sparse_tokens": 6713.0,
      "step": 6572,
      "turn_loss": 0.23846477270126343,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.3053800408845939,
      "grad_norm": 0.4828720986843109,
      "learning_rate": 4.325090283604626e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.032016903162002563,
      "mae_dx": 0.010273282416164875,
      "mae_dy": 0.004775065463036299,
      "pose_mae_dtheta": 0.24890026450157166,
      "pose_mae_dx": 0.0787506103515625,
      "pose_mae_dy": 0.0593898668885231,
      "pose_rmse_dtheta": 0.4428168535232544,
      "pose_rmse_dx": 0.18078891932964325,
      "pose_rmse_dy": 0.14541879296302795,
      "pose_rmse_mean": 0.2563415467739105,
      "rmse_dtheta": 0.049322471022605896,
      "rmse_dx": 0.02150815725326538,
      "rmse_dy": 0.010435828007757664,
      "rmse_mean": 0.027088819071650505,
      "rotation_flip": 0.00958466436713934,
      "sparse_tokens": 11335.0,
      "step": 6573,
      "turn_loss": 0.24998997151851654,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3054265006504367,
      "grad_norm": 0.38909056782722473,
      "learning_rate": 4.323780188960156e-06,
      "loss": 0.0788,
      "mae_dtheta": 0.0077994815073907375,
      "mae_dx": 0.0020331023260951042,
      "mae_dy": 0.0004541081434581429,
      "pose_mae_dtheta": 0.05520095303654671,
      "pose_mae_dx": 0.016016144305467606,
      "pose_mae_dy": 0.005644590128213167,
      "pose_rmse_dtheta": 0.23827150464057922,
      "pose_rmse_dx": 0.050156641751527786,
      "pose_rmse_dy": 0.0244761910289526,
      "pose_rmse_mean": 0.10430145263671875,
      "rmse_dtheta": 0.028563790023326874,
      "rmse_dx": 0.006643327884376049,
      "rmse_dy": 0.001650173799134791,
      "rmse_mean": 0.012285764329135418,
      "rotation_flip": 0.0012771391775459051,
      "sparse_tokens": 32185.0,
      "step": 6574,
      "turn_loss": 0.062464069575071335,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3054729604162795,
      "grad_norm": 0.4739168584346771,
      "learning_rate": 4.322470141604102e-06,
      "loss": 0.0912,
      "mae_dtheta": 0.008898359723389149,
      "mae_dx": 0.001436870195902884,
      "mae_dy": 0.001982178771868348,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4739168584346771,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.63308715820312,
      "model/head/act_norm_mean": 114.92724116161617,
      "model/head/act_norm_min": 80.7012710571289,
      "model/head/act_over_embed": 78.9790760920465,
      "model/head/grad_frac": 0.10722058266401291,
      "model/head/grad_norm": 0.050813641399145126,
      "model/head/grad_zero_frac": 0.00015006955072749406,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7080965909090909,
      "model/head/update_ratio": 0.0008672393159940839,
      "model/head/weight_delta": 9.210348129272461,
      "model/head/weight_delta_rel": 0.1615767925977707,
      "model/head/weight_norm": 58.592411041259766,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4215453565120697,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42148646341490853,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42140281200408936,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28964944367716616,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10035263746976852,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04755880683660507,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.490972422235023,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015366392908617854,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9772391319274902,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09727568179368973,
      "model/modality_embedder.encoders.pose/weight_norm": 30.94988250732422,
      "model/modality_embedder/grad_frac": 0.10035263746976852,
      "model/modality_embedder/grad_norm": 0.04755880683660507,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.490972422235023,
      "model/modality_embedder/update_ratio": 0.0015366392908617854,
      "model/modality_embedder/weight_delta": 2.9772391319274902,
      "model/modality_embedder/weight_delta_rel": 0.09727568179368973,
      "model/modality_embedder/weight_norm": 30.94988250732422,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.23687744140625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.07711038961039,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.984909057617188,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.546015673199175,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08059593290090561,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03819577023386955,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013697968097403646,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.388885498046875,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08705242723226547,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.884260177612305,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.17078399658203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.071546316337983,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.057564735412598,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.229401352102204,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07793058454990387,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03693261742591858,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012458793353289366,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.0288174152374268,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10492060333490372,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.643815994262695,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.1356201171875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.919798180214848,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.1981201171875,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.49953733656496,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09161806851625443,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04341934621334076,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014186162734404206,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.2665324211120605,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1096840426325798,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.606828689575195,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.7660140991211,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.670832832291165,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.214656829833984,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.7028647429165,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09951730817556381,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04716293141245842,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015798667445778847,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7931251525878906,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09545576572418213,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.852474212646484,
      "model/normalizer/grad_frac": 0.4332672655582428,
      "model/normalizer/grad_norm": 0.2053326666355133,
      "model/normalizer/grad_zero_frac": 0.00016426164074800909,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0026151842903345823,
      "model/normalizer/weight_delta": 5.90962028503418,
      "model/normalizer/weight_delta_rel": 0.07611248642206192,
      "model/normalizer/weight_norm": 78.51556396484375,
      "pose_mae_dtheta": 0.060450583696365356,
      "pose_mae_dx": 0.020672710612416267,
      "pose_mae_dy": 0.026265382766723633,
      "pose_rmse_dtheta": 0.14946110546588898,
      "pose_rmse_dx": 0.056076135486364365,
      "pose_rmse_dy": 0.06981809437274933,
      "pose_rmse_mean": 0.09178511798381805,
      "rmse_dtheta": 0.020877933129668236,
      "rmse_dx": 0.004697056952863932,
      "rmse_dy": 0.004834537860006094,
      "rmse_mean": 0.01013650931417942,
      "rotation_flip": 0.0017817371990531683,
      "sparse_tokens": 32057.0,
      "step": 6575,
      "turn_loss": 0.07229432463645935,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.3055194201821223,
      "grad_norm": 0.5479370951652527,
      "learning_rate": 4.321160141628073e-06,
      "loss": 0.1549,
      "mae_dtheta": 0.034257516264915466,
      "mae_dx": 0.01033336017280817,
      "mae_dy": 0.005446419585496187,
      "pose_mae_dtheta": 0.3268563151359558,
      "pose_mae_dx": 0.06694980710744858,
      "pose_mae_dy": 0.06738906353712082,
      "pose_rmse_dtheta": 0.5647174119949341,
      "pose_rmse_dx": 0.131002739071846,
      "pose_rmse_dy": 0.15827298164367676,
      "pose_rmse_mean": 0.2846643924713135,
      "rmse_dtheta": 0.052445754408836365,
      "rmse_dx": 0.02037808857858181,
      "rmse_dy": 0.010132906958460808,
      "rmse_mean": 0.027652252465486526,
      "rotation_flip": 0.017793593928217888,
      "sparse_tokens": 5024.0,
      "step": 6576,
      "turn_loss": 0.3304911255836487,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3055658799479651,
      "grad_norm": 0.6297511458396912,
      "learning_rate": 4.319850189123681e-06,
      "loss": 0.1731,
      "mae_dtheta": 0.010211280547082424,
      "mae_dx": 0.0016594772459939122,
      "mae_dy": 0.0027185317594558,
      "pose_mae_dtheta": 0.06670315563678741,
      "pose_mae_dx": 0.022440230473876,
      "pose_mae_dy": 0.027538875117897987,
      "pose_rmse_dtheta": 0.1549057513475418,
      "pose_rmse_dx": 0.05229489505290985,
      "pose_rmse_dy": 0.06873375177383423,
      "pose_rmse_mean": 0.09197813272476196,
      "rmse_dtheta": 0.020535120740532875,
      "rmse_dx": 0.0045265257358551025,
      "rmse_dy": 0.00596708245575428,
      "rmse_mean": 0.010342909954488277,
      "rotation_flip": 0.008815637789666653,
      "sparse_tokens": 32089.0,
      "step": 6577,
      "turn_loss": 0.09218893945217133,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.30561233971380786,
      "grad_norm": 0.3931925892829895,
      "learning_rate": 4.318540284182528e-06,
      "loss": 0.0703,
      "mae_dtheta": 0.00558230048045516,
      "mae_dx": 0.001563696307130158,
      "mae_dy": 0.0012581312330439687,
      "pose_mae_dtheta": 0.044055547565221786,
      "pose_mae_dx": 0.011893796734511852,
      "pose_mae_dy": 0.014145271852612495,
      "pose_rmse_dtheta": 0.12369876354932785,
      "pose_rmse_dx": 0.03312051296234131,
      "pose_rmse_dy": 0.03695116564631462,
      "pose_rmse_mean": 0.06459015607833862,
      "rmse_dtheta": 0.015912801027297974,
      "rmse_dx": 0.005480882246047258,
      "rmse_dy": 0.004651617258787155,
      "rmse_mean": 0.0086817666888237,
      "rotation_flip": 0.00493150670081377,
      "sparse_tokens": 32121.0,
      "step": 6578,
      "turn_loss": 0.055518049746751785,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.30565879947965063,
      "grad_norm": 0.4259140193462372,
      "learning_rate": 4.317230426896219e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.04105520248413086,
      "mae_dx": 0.011293795891106129,
      "mae_dy": 0.005269252695143223,
      "pose_mae_dtheta": 0.35124725103378296,
      "pose_mae_dx": 0.07656421512365341,
      "pose_mae_dy": 0.05017529055476189,
      "pose_rmse_dtheta": 0.5847679972648621,
      "pose_rmse_dx": 0.16887272894382477,
      "pose_rmse_dy": 0.1293220818042755,
      "pose_rmse_mean": 0.2943209409713745,
      "rmse_dtheta": 0.05960648134350777,
      "rmse_dx": 0.02282191440463066,
      "rmse_dy": 0.012136708945035934,
      "rmse_mean": 0.03152170404791832,
      "rotation_flip": 0.012416427955031395,
      "sparse_tokens": 17293.0,
      "step": 6579,
      "turn_loss": 0.3311960697174072,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3057052592454934,
      "grad_norm": 0.5396003127098083,
      "learning_rate": 4.315920617356355e-06,
      "loss": 0.1143,
      "mae_dtheta": 0.009799245744943619,
      "mae_dx": 0.001197267323732376,
      "mae_dy": 0.0019317908445373178,
      "pose_mae_dtheta": 0.0681910365819931,
      "pose_mae_dx": 0.01919560693204403,
      "pose_mae_dy": 0.027095511555671692,
      "pose_rmse_dtheta": 0.16935986280441284,
      "pose_rmse_dx": 0.05353614687919617,
      "pose_rmse_dy": 0.07133416086435318,
      "pose_rmse_mean": 0.0980767235159874,
      "rmse_dtheta": 0.02179567515850067,
      "rmse_dx": 0.0038869886193424463,
      "rmse_dy": 0.004355585668236017,
      "rmse_mean": 0.010012749582529068,
      "rotation_flip": 0.004576658830046654,
      "sparse_tokens": 32057.0,
      "step": 6580,
      "turn_loss": 0.07324574887752533,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3057517190113362,
      "grad_norm": 0.5974529385566711,
      "learning_rate": 4.314610855654528e-06,
      "loss": 0.0909,
      "mae_dtheta": 0.00991292018443346,
      "mae_dx": 0.0017072056652978063,
      "mae_dy": 0.0016387234209105372,
      "pose_mae_dtheta": 0.06726755946874619,
      "pose_mae_dx": 0.021415207535028458,
      "pose_mae_dy": 0.023905957117676735,
      "pose_rmse_dtheta": 0.15897490084171295,
      "pose_rmse_dx": 0.050590161234140396,
      "pose_rmse_dy": 0.06221909448504448,
      "pose_rmse_mean": 0.09059472382068634,
      "rmse_dtheta": 0.021770061925053596,
      "rmse_dx": 0.00492734182626009,
      "rmse_dy": 0.0034824253525584936,
      "rmse_mean": 0.010059943422675133,
      "rotation_flip": 0.0027899560518562794,
      "sparse_tokens": 32153.0,
      "step": 6581,
      "turn_loss": 0.08022434264421463,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30579817877717896,
      "grad_norm": 0.45215851068496704,
      "learning_rate": 4.3133011418823335e-06,
      "loss": 0.0919,
      "mae_dtheta": 0.008376062847673893,
      "mae_dx": 0.0014324173098430037,
      "mae_dy": 0.0021152507979422808,
      "pose_mae_dtheta": 0.058691393584012985,
      "pose_mae_dx": 0.020783474668860435,
      "pose_mae_dy": 0.02897568978369236,
      "pose_rmse_dtheta": 0.1198103129863739,
      "pose_rmse_dx": 0.05473237484693527,
      "pose_rmse_dy": 0.06921980530023575,
      "pose_rmse_mean": 0.08125416934490204,
      "rmse_dtheta": 0.016913700848817825,
      "rmse_dx": 0.004186058882623911,
      "rmse_dy": 0.00465987017378211,
      "rmse_mean": 0.00858654361218214,
      "rotation_flip": 0.003995205741375685,
      "sparse_tokens": 32089.0,
      "step": 6582,
      "turn_loss": 0.06571432203054428,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.30584463854302174,
      "grad_norm": 0.9388676881790161,
      "learning_rate": 4.3119914761313566e-06,
      "loss": 0.2132,
      "mae_dtheta": 0.033948589116334915,
      "mae_dx": 0.019350558519363403,
      "mae_dy": 0.0051969015039503574,
      "pose_mae_dtheta": 0.23621191084384918,
      "pose_mae_dx": 0.13978570699691772,
      "pose_mae_dy": 0.07464972883462906,
      "pose_rmse_dtheta": 0.4026225805282593,
      "pose_rmse_dx": 0.2676796615123749,
      "pose_rmse_dy": 0.17841579020023346,
      "pose_rmse_mean": 0.28290602564811707,
      "rmse_dtheta": 0.04947483539581299,
      "rmse_dx": 0.0332489088177681,
      "rmse_dy": 0.009525638073682785,
      "rmse_mean": 0.030749794095754623,
      "rotation_flip": 0.017199017107486725,
      "sparse_tokens": 7973.0,
      "step": 6583,
      "turn_loss": 0.24733896553516388,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.3058910983088645,
      "grad_norm": 0.8051828145980835,
      "learning_rate": 4.310681858493185e-06,
      "loss": 0.2826,
      "mae_dtheta": 0.0354781374335289,
      "mae_dx": 0.009124216623604298,
      "mae_dy": 0.0054814438335597515,
      "pose_mae_dtheta": 0.2905125021934509,
      "pose_mae_dx": 0.0877714455127716,
      "pose_mae_dy": 0.08080937713384628,
      "pose_rmse_dtheta": 0.5172731876373291,
      "pose_rmse_dx": 0.23446227610111237,
      "pose_rmse_dy": 0.16751627624034882,
      "pose_rmse_mean": 0.3064172565937042,
      "rmse_dtheta": 0.054302603006362915,
      "rmse_dx": 0.022438205778598785,
      "rmse_dy": 0.01026246976107359,
      "rmse_mean": 0.02900109253823757,
      "rotation_flip": 0.02083333395421505,
      "sparse_tokens": 11790.0,
      "step": 6584,
      "turn_loss": 0.315583199262619,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.3059375580747073,
      "grad_norm": 0.5897685885429382,
      "learning_rate": 4.309372289059403e-06,
      "loss": 0.1603,
      "mae_dtheta": 0.02564949542284012,
      "mae_dx": 0.0077895792201161385,
      "mae_dy": 0.004431132227182388,
      "pose_mae_dtheta": 0.2191706746816635,
      "pose_mae_dx": 0.061353057622909546,
      "pose_mae_dy": 0.05906737968325615,
      "pose_rmse_dtheta": 0.41881996393203735,
      "pose_rmse_dx": 0.16933396458625793,
      "pose_rmse_dy": 0.12602488696575165,
      "pose_rmse_mean": 0.2380596250295639,
      "rmse_dtheta": 0.04315580055117607,
      "rmse_dx": 0.019823512062430382,
      "rmse_dy": 0.008281764574348927,
      "rmse_mean": 0.0237536933273077,
      "rotation_flip": 0.0069605568423867226,
      "sparse_tokens": 10255.0,
      "step": 6585,
      "turn_loss": 0.22751109302043915,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.30598401784055007,
      "grad_norm": 1.1353034973144531,
      "learning_rate": 4.308062767921586e-06,
      "loss": 0.2805,
      "mae_dtheta": 0.04056892544031143,
      "mae_dx": 0.018628910183906555,
      "mae_dy": 0.003731255419552326,
      "pose_mae_dtheta": 0.3412327170372009,
      "pose_mae_dx": 0.14370566606521606,
      "pose_mae_dy": 0.05751392990350723,
      "pose_rmse_dtheta": 0.5761563777923584,
      "pose_rmse_dx": 0.3056212067604065,
      "pose_rmse_dy": 0.13666139543056488,
      "pose_rmse_mean": 0.3394796550273895,
      "rmse_dtheta": 0.05822087451815605,
      "rmse_dx": 0.033042777329683304,
      "rmse_dy": 0.008884049952030182,
      "rmse_mean": 0.03338256850838661,
      "rotation_flip": 0.006097560748457909,
      "sparse_tokens": 14842.0,
      "step": 6586,
      "turn_loss": 0.27465173602104187,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30603047760639285,
      "grad_norm": 0.6064069867134094,
      "learning_rate": 4.306753295171313e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.011035694740712643,
      "mae_dx": 0.0013696009991690516,
      "mae_dy": 0.002126595936715603,
      "pose_mae_dtheta": 0.07318431884050369,
      "pose_mae_dx": 0.02113734371960163,
      "pose_mae_dy": 0.03096570260822773,
      "pose_rmse_dtheta": 0.19339174032211304,
      "pose_rmse_dx": 0.05158461257815361,
      "pose_rmse_dy": 0.0982055589556694,
      "pose_rmse_mean": 0.11439397186040878,
      "rmse_dtheta": 0.024655615910887718,
      "rmse_dx": 0.004268160089850426,
      "rmse_dy": 0.005056328140199184,
      "rmse_mean": 0.011326702311635017,
      "rotation_flip": 0.005215123761445284,
      "sparse_tokens": 32089.0,
      "step": 6587,
      "turn_loss": 0.08503737300634384,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3060769373722356,
      "grad_norm": 0.430115669965744,
      "learning_rate": 4.305443870900151e-06,
      "loss": 0.0977,
      "mae_dtheta": 0.00797558855265379,
      "mae_dx": 0.00113289849832654,
      "mae_dy": 0.0018812742782756686,
      "pose_mae_dtheta": 0.050138670951128006,
      "pose_mae_dx": 0.016107887029647827,
      "pose_mae_dy": 0.024144474416971207,
      "pose_rmse_dtheta": 0.09196045994758606,
      "pose_rmse_dx": 0.03774379566311836,
      "pose_rmse_dy": 0.05597314611077309,
      "pose_rmse_mean": 0.06189246475696564,
      "rmse_dtheta": 0.015144525095820427,
      "rmse_dx": 0.003521841950714588,
      "rmse_dy": 0.003843107959255576,
      "rmse_mean": 0.007503158878535032,
      "rotation_flip": 0.002059308113530278,
      "sparse_tokens": 32057.0,
      "step": 6588,
      "turn_loss": 0.07183127850294113,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.3061233971380784,
      "grad_norm": 0.4705452620983124,
      "learning_rate": 4.304134495199675e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.02113611437380314,
      "mae_dx": 0.015401983633637428,
      "mae_dy": 0.0048841554671525955,
      "pose_mae_dtheta": 0.14034070074558258,
      "pose_mae_dx": 0.13174712657928467,
      "pose_mae_dy": 0.0643659308552742,
      "pose_rmse_dtheta": 0.2214544266462326,
      "pose_rmse_dx": 0.2816484272480011,
      "pose_rmse_dy": 0.13915233314037323,
      "pose_rmse_mean": 0.21408507227897644,
      "rmse_dtheta": 0.03566165268421173,
      "rmse_dx": 0.029633477330207825,
      "rmse_dy": 0.009611510671675205,
      "rmse_mean": 0.024968881160020828,
      "rotation_flip": 0.022160664200782776,
      "sparse_tokens": 7695.0,
      "step": 6589,
      "turn_loss": 0.2251865416765213,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3061698569039212,
      "grad_norm": 0.5302795171737671,
      "learning_rate": 4.302825168161444e-06,
      "loss": 0.1426,
      "mae_dtheta": 0.009218988008797169,
      "mae_dx": 0.0021311421878635883,
      "mae_dy": 0.0029130843468010426,
      "pose_mae_dtheta": 0.06669862568378448,
      "pose_mae_dx": 0.028655733913183212,
      "pose_mae_dy": 0.03174507990479469,
      "pose_rmse_dtheta": 0.154474139213562,
      "pose_rmse_dx": 0.0934726819396019,
      "pose_rmse_dy": 0.09957679361104965,
      "pose_rmse_mean": 0.11584120988845825,
      "rmse_dtheta": 0.020581452175974846,
      "rmse_dx": 0.0065977866761386395,
      "rmse_dy": 0.007959491573274136,
      "rmse_mean": 0.011712910607457161,
      "rotation_flip": 0.00539811048656702,
      "sparse_tokens": 32057.0,
      "step": 6590,
      "turn_loss": 0.08166330307722092,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19742.0,
      "epoch": 0.306216316669764,
      "grad_norm": 0.8628623485565186,
      "learning_rate": 4.3015158898770244e-06,
      "loss": 0.2869,
      "mae_dtheta": 0.028170377016067505,
      "mae_dx": 0.011899416334927082,
      "mae_dy": 0.006737358868122101,
      "pose_mae_dtheta": 0.2119407057762146,
      "pose_mae_dx": 0.08870328217744827,
      "pose_mae_dy": 0.08511415868997574,
      "pose_rmse_dtheta": 0.3856010437011719,
      "pose_rmse_dx": 0.19516588747501373,
      "pose_rmse_dy": 0.20937372744083405,
      "pose_rmse_mean": 0.263380229473114,
      "rmse_dtheta": 0.044531695544719696,
      "rmse_dx": 0.023630782961845398,
      "rmse_dy": 0.014056025072932243,
      "rmse_mean": 0.02740616910159588,
      "rotation_flip": 0.011866235174238682,
      "sparse_tokens": 14872.0,
      "step": 6591,
      "turn_loss": 0.27545979619026184,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3062627764356068,
      "grad_norm": 0.3891209363937378,
      "learning_rate": 4.300206660437975e-06,
      "loss": 0.0736,
      "mae_dtheta": 0.008299377746880054,
      "mae_dx": 0.0020776409655809402,
      "mae_dy": 0.0013124875258654356,
      "pose_mae_dtheta": 0.057946134358644485,
      "pose_mae_dx": 0.02077295444905758,
      "pose_mae_dy": 0.016947252675890923,
      "pose_rmse_dtheta": 0.18696124851703644,
      "pose_rmse_dx": 0.05824631080031395,
      "pose_rmse_dy": 0.042649317532777786,
      "pose_rmse_mean": 0.09595229476690292,
      "rmse_dtheta": 0.021295221522450447,
      "rmse_dx": 0.0065050250850617886,
      "rmse_dy": 0.003431060118600726,
      "rmse_mean": 0.010410435497760773,
      "rotation_flip": 0.0032921810634434223,
      "sparse_tokens": 32169.0,
      "step": 6592,
      "turn_loss": 0.06255907565355301,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.30630923620144956,
      "grad_norm": 0.4435478150844574,
      "learning_rate": 4.298897479935847e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.00692332535982132,
      "mae_dx": 0.0012058117426931858,
      "mae_dy": 0.0005211407551541924,
      "pose_mae_dtheta": 0.04828715696930885,
      "pose_mae_dx": 0.010807409882545471,
      "pose_mae_dy": 0.008319157175719738,
      "pose_rmse_dtheta": 0.20008879899978638,
      "pose_rmse_dx": 0.02528000809252262,
      "pose_rmse_dy": 0.02667444944381714,
      "pose_rmse_mean": 0.0840144157409668,
      "rmse_dtheta": 0.025138599798083305,
      "rmse_dx": 0.003472785698249936,
      "rmse_dy": 0.0011776629835367203,
      "rmse_mean": 0.009929683059453964,
      "rotation_flip": 0.0010325245093554258,
      "sparse_tokens": 32201.0,
      "step": 6593,
      "turn_loss": 0.042418885976076126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.30635569596729234,
      "grad_norm": 0.5046827793121338,
      "learning_rate": 4.297588348462197e-06,
      "loss": 0.0931,
      "mae_dtheta": 0.033140070736408234,
      "mae_dx": 0.007082986179739237,
      "mae_dy": 0.010002580471336842,
      "pose_mae_dtheta": 0.2356807291507721,
      "pose_mae_dx": 0.06062066927552223,
      "pose_mae_dy": 0.10907361656427383,
      "pose_rmse_dtheta": 0.4239935576915741,
      "pose_rmse_dx": 0.156589537858963,
      "pose_rmse_dy": 0.25508013367652893,
      "pose_rmse_mean": 0.27855440974235535,
      "rmse_dtheta": 0.05043177306652069,
      "rmse_dx": 0.01761510968208313,
      "rmse_dy": 0.01951625943183899,
      "rmse_mean": 0.02918771468102932,
      "rotation_flip": 0.014652014710009098,
      "sparse_tokens": 4762.0,
      "step": 6594,
      "turn_loss": 0.2547779381275177,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 25556.0,
      "epoch": 0.3064021557331351,
      "grad_norm": 0.6564568877220154,
      "learning_rate": 4.296279266108569e-06,
      "loss": 0.171,
      "mae_dtheta": 0.03227801248431206,
      "mae_dx": 0.011419312097132206,
      "mae_dy": 0.003683176590129733,
      "pose_mae_dtheta": 0.2712995409965515,
      "pose_mae_dx": 0.09184864908456802,
      "pose_mae_dy": 0.05334462970495224,
      "pose_rmse_dtheta": 0.488402783870697,
      "pose_rmse_dx": 0.21576155722141266,
      "pose_rmse_dy": 0.1279144138097763,
      "pose_rmse_mean": 0.27735960483551025,
      "rmse_dtheta": 0.05017416924238205,
      "rmse_dx": 0.023448476567864418,
      "rmse_dy": 0.007400207687169313,
      "rmse_mean": 0.02700761705636978,
      "rotation_flip": 0.012149532325565815,
      "sparse_tokens": 18548.0,
      "step": 6595,
      "turn_loss": 0.2610137164592743,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3064486154989779,
      "grad_norm": 0.4880465269088745,
      "learning_rate": 4.294970232966512e-06,
      "loss": 0.0993,
      "mae_dtheta": 0.007561796810477972,
      "mae_dx": 0.004235049244016409,
      "mae_dy": 0.0015837950631976128,
      "pose_mae_dtheta": 0.05432279035449028,
      "pose_mae_dx": 0.035555195063352585,
      "pose_mae_dy": 0.021401526406407356,
      "pose_rmse_dtheta": 0.15231949090957642,
      "pose_rmse_dx": 0.11636682599782944,
      "pose_rmse_dy": 0.06399805098772049,
      "pose_rmse_mean": 0.11089479178190231,
      "rmse_dtheta": 0.02030583843588829,
      "rmse_dx": 0.013122985139489174,
      "rmse_dy": 0.0038368578534573317,
      "rmse_mean": 0.012421894818544388,
      "rotation_flip": 0.0040017785504460335,
      "sparse_tokens": 32185.0,
      "step": 6596,
      "turn_loss": 0.10112039744853973,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.30649507526482067,
      "grad_norm": 0.8434684872627258,
      "learning_rate": 4.293661249127562e-06,
      "loss": 0.1114,
      "mae_dtheta": 0.017991377040743828,
      "mae_dx": 0.002992783673107624,
      "mae_dy": 0.0036589934024959803,
      "pose_mae_dtheta": 0.15198877453804016,
      "pose_mae_dx": 0.030812233686447144,
      "pose_mae_dy": 0.06907805800437927,
      "pose_rmse_dtheta": 0.25755369663238525,
      "pose_rmse_dx": 0.06967524439096451,
      "pose_rmse_dy": 0.12968763709068298,
      "pose_rmse_mean": 0.15230552852153778,
      "rmse_dtheta": 0.030028551816940308,
      "rmse_dx": 0.009339317679405212,
      "rmse_dy": 0.005813806317746639,
      "rmse_mean": 0.015060558915138245,
      "rotation_flip": 0.013227513059973717,
      "sparse_tokens": 6962.0,
      "step": 6597,
      "turn_loss": 0.11327147483825684,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30654153503066345,
      "grad_norm": 0.595894455909729,
      "learning_rate": 4.292352314683261e-06,
      "loss": 0.1565,
      "mae_dtheta": 0.014057831838726997,
      "mae_dx": 0.0021132451947778463,
      "mae_dy": 0.0028102716896682978,
      "pose_mae_dtheta": 0.09830160439014435,
      "pose_mae_dx": 0.027007248252630234,
      "pose_mae_dy": 0.034676674753427505,
      "pose_rmse_dtheta": 0.22097283601760864,
      "pose_rmse_dx": 0.06550430506467819,
      "pose_rmse_dy": 0.07508160918951035,
      "pose_rmse_mean": 0.12051959335803986,
      "rmse_dtheta": 0.026019133627414703,
      "rmse_dx": 0.006280587520450354,
      "rmse_dy": 0.005429970100522041,
      "rmse_mean": 0.012576563283801079,
      "rotation_flip": 0.0038381018675863743,
      "sparse_tokens": 32089.0,
      "step": 6598,
      "turn_loss": 0.10160337388515472,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.3065879947965062,
      "grad_norm": 0.7878197431564331,
      "learning_rate": 4.291043429725143e-06,
      "loss": 0.1944,
      "mae_dtheta": 0.024640144780278206,
      "mae_dx": 0.007531050592660904,
      "mae_dy": 0.006828389596194029,
      "pose_mae_dtheta": 0.20044530928134918,
      "pose_mae_dx": 0.055660445243120193,
      "pose_mae_dy": 0.050970543175935745,
      "pose_rmse_dtheta": 0.42720553278923035,
      "pose_rmse_dx": 0.11746151000261307,
      "pose_rmse_dy": 0.09784272313117981,
      "pose_rmse_mean": 0.2141699492931366,
      "rmse_dtheta": 0.04460899531841278,
      "rmse_dx": 0.01704360917210579,
      "rmse_dy": 0.014984223060309887,
      "rmse_mean": 0.02554561011493206,
      "rotation_flip": 0.011450381949543953,
      "sparse_tokens": 32217.0,
      "step": 6599,
      "turn_loss": 0.2715968191623688,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.306634454562349,
      "grad_norm": 0.6253615021705627,
      "learning_rate": 4.289734594344738e-06,
      "loss": 0.1056,
      "mae_dtheta": 0.020965110510587692,
      "mae_dx": 0.012847182340919971,
      "mae_dy": 0.004778814502060413,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6253613829612732,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 136.11865234375,
      "model/head/act_norm_mean": 111.98271484375,
      "model/head/act_norm_min": 81.72867584228516,
      "model/head/act_over_embed": 76.95557003931916,
      "model/head/grad_frac": 0.11147655546665192,
      "model/head/grad_norm": 0.06971313059329987,
      "model/head/grad_zero_frac": 0.0001776721910573542,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.69267578125,
      "model/head/update_ratio": 0.0011897507356479764,
      "model/head/weight_delta": 9.220719337463379,
      "model/head/weight_delta_rel": 0.16175873577594757,
      "model/head/weight_norm": 58.5947380065918,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4214933514595032,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4214933514595032,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4214933514595032,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2896541772058985,
      "model/modality_embedder.encoders.pose/grad_frac": 0.061367277055978775,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03837672621011734,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001239950768649578,
      "model/modality_embedder.encoders.pose/weight_delta": 2.976986885070801,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09726744145154953,
      "model/modality_embedder.encoders.pose/weight_norm": 30.95020294189453,
      "model/modality_embedder/grad_frac": 0.061367277055978775,
      "model/modality_embedder/grad_norm": 0.03837672621011734,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.001239950768649578,
      "model/modality_embedder/weight_delta": 2.976986885070801,
      "model/modality_embedder/weight_delta_rel": 0.09726744145154953,
      "model/modality_embedder/weight_norm": 30.95020294189453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.76900482177734,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.773463851686508,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.212231636047363,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.337346929554204,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08787928521633148,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.054956309497356415,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001970830373466015,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.3926339149475098,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08718902617692947,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.884849548339844,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.89408111572266,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.583931671626985,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.716269493103027,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.89430800313658,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08179539442062378,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05115168169140816,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0003026145859621465,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017254592385143042,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.0346550941467285,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10512282699346542,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.64525604248047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 76.2001724243164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.13642113095238,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.077256202697754,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.961193294220305,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07549785077571869,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.047213438898324966,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015425056917592883,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.272696018218994,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.10989100486040115,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.608274459838867,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.66301727294922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.030484250992064,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.693034172058105,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.262811202809885,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0745876356959343,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04664422571659088,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015624234220013022,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.7981510162353516,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09562752395868301,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.85376739501953,
      "model/normalizer/grad_frac": 0.2660931348800659,
      "model/normalizer/grad_norm": 0.1664043664932251,
      "model/normalizer/grad_zero_frac": 0.00023516594956163317,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021193355787545443,
      "model/normalizer/weight_delta": 5.920463562011719,
      "model/normalizer/weight_delta_rel": 0.07625214010477066,
      "model/normalizer/weight_norm": 78.5172348022461,
      "pose_mae_dtheta": 0.1964782327413559,
      "pose_mae_dx": 0.0974564254283905,
      "pose_mae_dy": 0.0719548836350441,
      "pose_rmse_dtheta": 0.3110380470752716,
      "pose_rmse_dx": 0.2320474088191986,
      "pose_rmse_dy": 0.17092566192150116,
      "pose_rmse_mean": 0.2380037158727646,
      "rmse_dtheta": 0.034194786101579666,
      "rmse_dx": 0.025476999580860138,
      "rmse_dy": 0.00889828335493803,
      "rmse_mean": 0.022856689989566803,
      "rotation_flip": 0.009389671497046947,
      "sparse_tokens": 5002.0,
      "step": 6600,
      "turn_loss": 0.21081726253032684,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "epoch": 0.306634454562349,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30715659260749817,
      "eval_objectnav_nopose_mae_dtheta": 0.03998054936528206,
      "eval_objectnav_nopose_mae_dx": 0.013914105482399464,
      "eval_objectnav_nopose_mae_dy": 0.005031959619373083,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3206205368041992,
      "eval_objectnav_nopose_pose_mae_dx": 0.1108551099896431,
      "eval_objectnav_nopose_pose_mae_dy": 0.05696074292063713,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5351422429084778,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23978528380393982,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13421110808849335,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30304622650146484,
      "eval_objectnav_nopose_rmse_dtheta": 0.057491693645715714,
      "eval_objectnav_nopose_rmse_dx": 0.026636339724063873,
      "eval_objectnav_nopose_rmse_dy": 0.010190424509346485,
      "eval_objectnav_nopose_rmse_mean": 0.031439490616321564,
      "eval_objectnav_nopose_rotation_flip": 0.016034523025155067,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30715659260749817,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 6600
    },
    {
      "epoch": 0.306634454562349,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2800179719924927,
      "eval_objectnav_pose_mae_dtheta": 0.036379989236593246,
      "eval_objectnav_pose_mae_dx": 0.01183719839900732,
      "eval_objectnav_pose_mae_dy": 0.00483294203877449,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2776685655117035,
      "eval_objectnav_pose_pose_mae_dx": 0.09244908392429352,
      "eval_objectnav_pose_pose_mae_dy": 0.0499882847070694,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4797433614730835,
      "eval_objectnav_pose_pose_rmse_dx": 0.21097734570503235,
      "eval_objectnav_pose_pose_rmse_dy": 0.12081574648618698,
      "eval_objectnav_pose_pose_rmse_mean": 0.2705121636390686,
      "eval_objectnav_pose_rmse_dtheta": 0.05396709591150284,
      "eval_objectnav_pose_rmse_dx": 0.02410348691046238,
      "eval_objectnav_pose_rmse_dy": 0.010025258176028728,
      "eval_objectnav_pose_rmse_mean": 0.029365278780460358,
      "eval_objectnav_pose_rotation_flip": 0.01570415310561657,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2800179719924927,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 6600
    },
    {
      "epoch": 0.306634454562349,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09271074831485748,
      "eval_pointnav_mae_dtheta": 0.010688701644539833,
      "eval_pointnav_mae_dx": 0.0024086220655590296,
      "eval_pointnav_mae_dy": 0.0024385119322687387,
      "eval_pointnav_pose_mae_dtheta": 0.07514513283967972,
      "eval_pointnav_pose_mae_dx": 0.027144301682710648,
      "eval_pointnav_pose_mae_dy": 0.027066875249147415,
      "eval_pointnav_pose_rmse_dtheta": 0.21014823019504547,
      "eval_pointnav_pose_rmse_dx": 0.08164943009614944,
      "eval_pointnav_pose_rmse_dy": 0.07778549939393997,
      "eval_pointnav_pose_rmse_mean": 0.1231943890452385,
      "eval_pointnav_rmse_dtheta": 0.02585899829864502,
      "eval_pointnav_rmse_dx": 0.00766883185133338,
      "eval_pointnav_rmse_dy": 0.006434401962906122,
      "eval_pointnav_rmse_mean": 0.013320744037628174,
      "eval_pointnav_rotation_flip": 0.005186900030821562,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09271074831485748,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 6600
    },
    {
      "epoch": 0.306634454562349,
      "eval_loss": 0.22662843763828278,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30715659260749817,
      "eval_objectnav_nopose_mae_dtheta": 0.03998054936528206,
      "eval_objectnav_nopose_mae_dx": 0.013914105482399464,
      "eval_objectnav_nopose_mae_dy": 0.005031959619373083,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3206205368041992,
      "eval_objectnav_nopose_pose_mae_dx": 0.1108551099896431,
      "eval_objectnav_nopose_pose_mae_dy": 0.05696074292063713,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5351422429084778,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23978528380393982,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13421110808849335,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30304622650146484,
      "eval_objectnav_nopose_rmse_dtheta": 0.057491693645715714,
      "eval_objectnav_nopose_rmse_dx": 0.026636339724063873,
      "eval_objectnav_nopose_rmse_dy": 0.010190424509346485,
      "eval_objectnav_nopose_rmse_mean": 0.031439490616321564,
      "eval_objectnav_nopose_rotation_flip": 0.016034523025155067,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30715659260749817,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2800179719924927,
      "eval_objectnav_pose_mae_dtheta": 0.036379989236593246,
      "eval_objectnav_pose_mae_dx": 0.01183719839900732,
      "eval_objectnav_pose_mae_dy": 0.00483294203877449,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2776685655117035,
      "eval_objectnav_pose_pose_mae_dx": 0.09244908392429352,
      "eval_objectnav_pose_pose_mae_dy": 0.0499882847070694,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4797433614730835,
      "eval_objectnav_pose_pose_rmse_dx": 0.21097734570503235,
      "eval_objectnav_pose_pose_rmse_dy": 0.12081574648618698,
      "eval_objectnav_pose_pose_rmse_mean": 0.2705121636390686,
      "eval_objectnav_pose_rmse_dtheta": 0.05396709591150284,
      "eval_objectnav_pose_rmse_dx": 0.02410348691046238,
      "eval_objectnav_pose_rmse_dy": 0.010025258176028728,
      "eval_objectnav_pose_rmse_mean": 0.029365278780460358,
      "eval_objectnav_pose_rotation_flip": 0.01570415310561657,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2800179719924927,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09271074831485748,
      "eval_pointnav_mae_dtheta": 0.010688701644539833,
      "eval_pointnav_mae_dx": 0.0024086220655590296,
      "eval_pointnav_mae_dy": 0.0024385119322687387,
      "eval_pointnav_pose_mae_dtheta": 0.07514513283967972,
      "eval_pointnav_pose_mae_dx": 0.027144301682710648,
      "eval_pointnav_pose_mae_dy": 0.027066875249147415,
      "eval_pointnav_pose_rmse_dtheta": 0.21014823019504547,
      "eval_pointnav_pose_rmse_dx": 0.08164943009614944,
      "eval_pointnav_pose_rmse_dy": 0.07778549939393997,
      "eval_pointnav_pose_rmse_mean": 0.1231943890452385,
      "eval_pointnav_rmse_dtheta": 0.02585899829864502,
      "eval_pointnav_rmse_dx": 0.00766883185133338,
      "eval_pointnav_rmse_dy": 0.006434401962906122,
      "eval_pointnav_rmse_mean": 0.013320744037628174,
      "eval_pointnav_rotation_flip": 0.005186900030821562,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09271074831485748,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 6600
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3066809143281918,
      "grad_norm": 0.44081196188926697,
      "learning_rate": 4.2884258086335755e-06,
      "loss": 0.0807,
      "mae_dtheta": 0.011412793770432472,
      "mae_dx": 0.0018276434857398272,
      "mae_dy": 0.002744954312220216,
      "pose_mae_dtheta": 0.08302977681159973,
      "pose_mae_dx": 0.025805212557315826,
      "pose_mae_dy": 0.031877655535936356,
      "pose_rmse_dtheta": 0.21383854746818542,
      "pose_rmse_dx": 0.08524244278669357,
      "pose_rmse_dy": 0.08235153555870056,
      "pose_rmse_mean": 0.12714418768882751,
      "rmse_dtheta": 0.025286583229899406,
      "rmse_dx": 0.0057157729752361774,
      "rmse_dy": 0.0071328007616102695,
      "rmse_mean": 0.012711718678474426,
      "rotation_flip": 0.0029154520016163588,
      "sparse_tokens": 32057.0,
      "step": 6601,
      "turn_loss": 0.08670023083686829,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.30672737409403455,
      "grad_norm": 0.6382499933242798,
      "learning_rate": 4.287117072683175e-06,
      "loss": 0.0907,
      "mae_dtheta": 0.012067964300513268,
      "mae_dx": 0.003442902583628893,
      "mae_dy": 0.004382255021482706,
      "pose_mae_dtheta": 0.08978357166051865,
      "pose_mae_dx": 0.045870888978242874,
      "pose_mae_dy": 0.0409165695309639,
      "pose_rmse_dtheta": 0.2062428891658783,
      "pose_rmse_dx": 0.12586736679077148,
      "pose_rmse_dy": 0.10860177129507065,
      "pose_rmse_mean": 0.14690402150154114,
      "rmse_dtheta": 0.025294320657849312,
      "rmse_dx": 0.010051652789115906,
      "rmse_dy": 0.009816726669669151,
      "rmse_mean": 0.015054233372211456,
      "rotation_flip": 0.006155950948596001,
      "sparse_tokens": 32137.0,
      "step": 6602,
      "turn_loss": 0.12682300806045532,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.30677383385987733,
      "grad_norm": 0.34739425778388977,
      "learning_rate": 4.285808386585063e-06,
      "loss": 0.1031,
      "mae_dtheta": 0.010661479085683823,
      "mae_dx": 0.002435801550745964,
      "mae_dy": 0.0020309577230364084,
      "pose_mae_dtheta": 0.07191040366888046,
      "pose_mae_dx": 0.0225619338452816,
      "pose_mae_dy": 0.02657221630215645,
      "pose_rmse_dtheta": 0.17896442115306854,
      "pose_rmse_dx": 0.05795547366142273,
      "pose_rmse_dy": 0.057423681020736694,
      "pose_rmse_mean": 0.09811453521251678,
      "rmse_dtheta": 0.022013604640960693,
      "rmse_dx": 0.007716423831880093,
      "rmse_dy": 0.004026174079626799,
      "rmse_mean": 0.011252067983150482,
      "rotation_flip": 0.004807692486792803,
      "sparse_tokens": 32121.0,
      "step": 6603,
      "turn_loss": 0.09375856071710587,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.3068202936257201,
      "grad_norm": 0.5583303570747375,
      "learning_rate": 4.284499750430753e-06,
      "loss": 0.1781,
      "mae_dtheta": 0.023189155384898186,
      "mae_dx": 0.011059359647333622,
      "mae_dy": 0.0033533545210957527,
      "pose_mae_dtheta": 0.166988804936409,
      "pose_mae_dx": 0.07827939838171005,
      "pose_mae_dy": 0.037326470017433167,
      "pose_rmse_dtheta": 0.32548853754997253,
      "pose_rmse_dx": 0.1856226772069931,
      "pose_rmse_dy": 0.10793597996234894,
      "pose_rmse_mean": 0.20634905993938446,
      "rmse_dtheta": 0.04000291973352432,
      "rmse_dx": 0.023114364594221115,
      "rmse_dy": 0.007128382567316294,
      "rmse_mean": 0.02341522090137005,
      "rotation_flip": 0.013313609175384045,
      "sparse_tokens": 11427.0,
      "step": 6604,
      "turn_loss": 0.2078331857919693,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.3068667533915629,
      "grad_norm": 0.5106257796287537,
      "learning_rate": 4.2831911643117594e-06,
      "loss": 0.1641,
      "mae_dtheta": 0.03199043869972229,
      "mae_dx": 0.013502223417162895,
      "mae_dy": 0.004429159220308065,
      "pose_mae_dtheta": 0.2793622314929962,
      "pose_mae_dx": 0.10247161984443665,
      "pose_mae_dy": 0.06140482425689697,
      "pose_rmse_dtheta": 0.46351557970046997,
      "pose_rmse_dx": 0.22513073682785034,
      "pose_rmse_dy": 0.15614230930805206,
      "pose_rmse_mean": 0.28159621357917786,
      "rmse_dtheta": 0.048787232488393784,
      "rmse_dx": 0.026459403336048126,
      "rmse_dy": 0.010057831183075905,
      "rmse_mean": 0.028434820473194122,
      "rotation_flip": 0.013129102997481823,
      "sparse_tokens": 9496.0,
      "step": 6605,
      "turn_loss": 0.28011590242385864,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.30691321315740566,
      "grad_norm": 0.497249037027359,
      "learning_rate": 4.281882628319594e-06,
      "loss": 0.1208,
      "mae_dtheta": 0.011711562052369118,
      "mae_dx": 0.0018628766993060708,
      "mae_dy": 0.002538643777370453,
      "pose_mae_dtheta": 0.07514232397079468,
      "pose_mae_dx": 0.020724672824144363,
      "pose_mae_dy": 0.02913074754178524,
      "pose_rmse_dtheta": 0.19003093242645264,
      "pose_rmse_dx": 0.053827252238988876,
      "pose_rmse_dy": 0.06277685612440109,
      "pose_rmse_mean": 0.10221168398857117,
      "rmse_dtheta": 0.024303745478391647,
      "rmse_dx": 0.005408100318163633,
      "rmse_dy": 0.00560778146609664,
      "rmse_mean": 0.01177320908755064,
      "rotation_flip": 0.00498398020863533,
      "sparse_tokens": 32137.0,
      "step": 6606,
      "turn_loss": 0.09321838617324829,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3069596729232485,
      "grad_norm": 0.3794887959957123,
      "learning_rate": 4.28057414254576e-06,
      "loss": 0.068,
      "mae_dtheta": 0.006436007097363472,
      "mae_dx": 0.00122170546092093,
      "mae_dy": 0.0011852747993543744,
      "pose_mae_dtheta": 0.04712380841374397,
      "pose_mae_dx": 0.012976986356079578,
      "pose_mae_dy": 0.016763610765337944,
      "pose_rmse_dtheta": 0.12753508985042572,
      "pose_rmse_dx": 0.03683432191610336,
      "pose_rmse_dy": 0.04661405086517334,
      "pose_rmse_mean": 0.07032781839370728,
      "rmse_dtheta": 0.015780014917254448,
      "rmse_dx": 0.00412856275215745,
      "rmse_dy": 0.0032390691339969635,
      "rmse_mean": 0.007715882267802954,
      "rotation_flip": 0.0019193857442587614,
      "sparse_tokens": 32089.0,
      "step": 6607,
      "turn_loss": 0.0467679537832737,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.30700613268909127,
      "grad_norm": 1.039568543434143,
      "learning_rate": 4.279265707081763e-06,
      "loss": 0.2082,
      "mae_dtheta": 0.02936185710132122,
      "mae_dx": 0.009357261471450329,
      "mae_dy": 0.0045646303333342075,
      "pose_mae_dtheta": 0.20328772068023682,
      "pose_mae_dx": 0.09091824293136597,
      "pose_mae_dy": 0.0784367173910141,
      "pose_rmse_dtheta": 0.3617900311946869,
      "pose_rmse_dx": 0.18335796892642975,
      "pose_rmse_dy": 0.12787576019763947,
      "pose_rmse_mean": 0.2243412584066391,
      "rmse_dtheta": 0.041592150926589966,
      "rmse_dx": 0.020811356604099274,
      "rmse_dy": 0.007012675050646067,
      "rmse_mean": 0.023138727992773056,
      "rotation_flip": 0.023391813039779663,
      "sparse_tokens": 3166.0,
      "step": 6608,
      "turn_loss": 0.22013874351978302,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 36663.0,
      "epoch": 0.30705259245493405,
      "grad_norm": 0.6017886400222778,
      "learning_rate": 4.277957322019101e-06,
      "loss": 0.1859,
      "mae_dtheta": 0.03224765509366989,
      "mae_dx": 0.01243903860449791,
      "mae_dy": 0.005341921932995319,
      "pose_mae_dtheta": 0.24896804988384247,
      "pose_mae_dx": 0.08627907931804657,
      "pose_mae_dy": 0.06658534705638885,
      "pose_rmse_dtheta": 0.43730300664901733,
      "pose_rmse_dx": 0.1958065629005432,
      "pose_rmse_dy": 0.16927695274353027,
      "pose_rmse_mean": 0.26746219396591187,
      "rmse_dtheta": 0.04981966316699982,
      "rmse_dx": 0.024961799383163452,
      "rmse_dy": 0.010751684196293354,
      "rmse_mean": 0.02851105108857155,
      "rotation_flip": 0.010448678396642208,
      "sparse_tokens": 28851.0,
      "step": 6609,
      "turn_loss": 0.2509864568710327,
      "turns": 113.0,
      "turns_per_sample": 113.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3070990522207768,
      "grad_norm": 0.4009963274002075,
      "learning_rate": 4.276648987449271e-06,
      "loss": 0.0845,
      "mae_dtheta": 0.006886416580528021,
      "mae_dx": 0.0018185927765443921,
      "mae_dy": 0.0020226514898240566,
      "pose_mae_dtheta": 0.049217719584703445,
      "pose_mae_dx": 0.01900041103363037,
      "pose_mae_dy": 0.020769357681274414,
      "pose_rmse_dtheta": 0.11656038463115692,
      "pose_rmse_dx": 0.049199365079402924,
      "pose_rmse_dy": 0.050944533199071884,
      "pose_rmse_mean": 0.07223476469516754,
      "rmse_dtheta": 0.01665171980857849,
      "rmse_dx": 0.005198574624955654,
      "rmse_dy": 0.0055131190456449986,
      "rmse_mean": 0.009121138602495193,
      "rotation_flip": 0.002254283055663109,
      "sparse_tokens": 32137.0,
      "step": 6610,
      "turn_loss": 0.06483284384012222,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31467.0,
      "epoch": 0.3071455119866196,
      "grad_norm": 0.515143096446991,
      "learning_rate": 4.275340703463767e-06,
      "loss": 0.1515,
      "mae_dtheta": 0.0335981510579586,
      "mae_dx": 0.009586761705577374,
      "mae_dy": 0.005608174949884415,
      "pose_mae_dtheta": 0.24453559517860413,
      "pose_mae_dx": 0.07461884617805481,
      "pose_mae_dy": 0.05938488990068436,
      "pose_rmse_dtheta": 0.4448150396347046,
      "pose_rmse_dx": 0.18917566537857056,
      "pose_rmse_dy": 0.13552512228488922,
      "pose_rmse_mean": 0.2565052807331085,
      "rmse_dtheta": 0.052839696407318115,
      "rmse_dx": 0.021805789321660995,
      "rmse_dy": 0.01279534213244915,
      "rmse_mean": 0.029146945104002953,
      "rotation_flip": 0.012048192322254181,
      "sparse_tokens": 24117.0,
      "step": 6611,
      "turn_loss": 0.26894569396972656,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 25558.0,
      "epoch": 0.3071919717524624,
      "grad_norm": 0.9189313054084778,
      "learning_rate": 4.274032470154076e-06,
      "loss": 0.2452,
      "mae_dtheta": 0.029447536915540695,
      "mae_dx": 0.01107112318277359,
      "mae_dy": 0.005428371950984001,
      "pose_mae_dtheta": 0.21933569014072418,
      "pose_mae_dx": 0.09555193036794662,
      "pose_mae_dy": 0.075391486287117,
      "pose_rmse_dtheta": 0.4046008884906769,
      "pose_rmse_dx": 0.2304368019104004,
      "pose_rmse_dy": 0.18575894832611084,
      "pose_rmse_mean": 0.27359887957572937,
      "rmse_dtheta": 0.046213191002607346,
      "rmse_dx": 0.024081502109766006,
      "rmse_dy": 0.010514377616345882,
      "rmse_mean": 0.026936357840895653,
      "rotation_flip": 0.014734773896634579,
      "sparse_tokens": 21380.0,
      "step": 6612,
      "turn_loss": 0.23597587645053864,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.30723843151830516,
      "grad_norm": 0.5017090439796448,
      "learning_rate": 4.272724287611684e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.008910716511309147,
      "mae_dx": 0.0012004446471109986,
      "mae_dy": 0.00033967028139159083,
      "pose_mae_dtheta": 0.06635157018899918,
      "pose_mae_dx": 0.01028598565608263,
      "pose_mae_dy": 0.005274482071399689,
      "pose_rmse_dtheta": 0.2794314920902252,
      "pose_rmse_dx": 0.025299787521362305,
      "pose_rmse_dy": 0.017834756523370743,
      "pose_rmse_mean": 0.10752201080322266,
      "rmse_dtheta": 0.0318632572889328,
      "rmse_dx": 0.003679148154333234,
      "rmse_dy": 0.0008728851680643857,
      "rmse_mean": 0.012138430029153824,
      "rotation_flip": 0.0036049026530236006,
      "sparse_tokens": 32153.0,
      "step": 6613,
      "turn_loss": 0.04012732952833176,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.30728489128414793,
      "grad_norm": 0.5837209820747375,
      "learning_rate": 4.271416155928072e-06,
      "loss": 0.1399,
      "mae_dtheta": 0.006659790873527527,
      "mae_dx": 0.0010551464511081576,
      "mae_dy": 0.00166141998488456,
      "pose_mae_dtheta": 0.04397822171449661,
      "pose_mae_dx": 0.01457965187728405,
      "pose_mae_dy": 0.023112917318940163,
      "pose_rmse_dtheta": 0.11089643090963364,
      "pose_rmse_dx": 0.041303858160972595,
      "pose_rmse_dy": 0.06895481795072556,
      "pose_rmse_mean": 0.0737183690071106,
      "rmse_dtheta": 0.01504218764603138,
      "rmse_dx": 0.0038565087597817183,
      "rmse_dy": 0.0040380642749369144,
      "rmse_mean": 0.007645586505532265,
      "rotation_flip": 0.0010582010727375746,
      "sparse_tokens": 32041.0,
      "step": 6614,
      "turn_loss": 0.06344637274742126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3073313510499907,
      "grad_norm": 0.3352794051170349,
      "learning_rate": 4.270108075194721e-06,
      "loss": 0.0981,
      "mae_dtheta": 0.011392958462238312,
      "mae_dx": 0.0018539809389039874,
      "mae_dy": 0.0022565850522369146,
      "pose_mae_dtheta": 0.0752304270863533,
      "pose_mae_dx": 0.02436607889831066,
      "pose_mae_dy": 0.024959076195955276,
      "pose_rmse_dtheta": 0.19377079606056213,
      "pose_rmse_dx": 0.059400077909231186,
      "pose_rmse_dy": 0.059860169887542725,
      "pose_rmse_mean": 0.10434368252754211,
      "rmse_dtheta": 0.025330498814582825,
      "rmse_dx": 0.004984915256500244,
      "rmse_dy": 0.005131263751536608,
      "rmse_mean": 0.01181555911898613,
      "rotation_flip": 0.003988831304013729,
      "sparse_tokens": 32137.0,
      "step": 6615,
      "turn_loss": 0.07987680286169052,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3073778108158335,
      "grad_norm": 0.58235764503479,
      "learning_rate": 4.268800045503102e-06,
      "loss": 0.0856,
      "mae_dtheta": 0.007248853333294392,
      "mae_dx": 0.001067472156137228,
      "mae_dy": 0.0013158570509403944,
      "pose_mae_dtheta": 0.051089756190776825,
      "pose_mae_dx": 0.015151510015130043,
      "pose_mae_dy": 0.019736398011446,
      "pose_rmse_dtheta": 0.16525664925575256,
      "pose_rmse_dx": 0.03699870407581329,
      "pose_rmse_dy": 0.05114788934588432,
      "pose_rmse_mean": 0.08446775376796722,
      "rmse_dtheta": 0.01931326650083065,
      "rmse_dx": 0.0035953233018517494,
      "rmse_dy": 0.002836648840457201,
      "rmse_mean": 0.008581746369600296,
      "rotation_flip": 0.000871839583851397,
      "sparse_tokens": 32089.0,
      "step": 6616,
      "turn_loss": 0.04962438344955444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.30742427058167626,
      "grad_norm": 0.5090659856796265,
      "learning_rate": 4.267492066944688e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.04592474550008774,
      "mae_dx": 0.015134114772081375,
      "mae_dy": 0.004457946866750717,
      "pose_mae_dtheta": 0.3386504054069519,
      "pose_mae_dx": 0.11427029222249985,
      "pose_mae_dy": 0.048367828130722046,
      "pose_rmse_dtheta": 0.5988831520080566,
      "pose_rmse_dx": 0.24017740786075592,
      "pose_rmse_dy": 0.11782503873109818,
      "pose_rmse_mean": 0.31896185874938965,
      "rmse_dtheta": 0.06706251949071884,
      "rmse_dx": 0.028505418449640274,
      "rmse_dy": 0.009358388371765614,
      "rmse_mean": 0.03497544676065445,
      "rotation_flip": 0.0071090045385062695,
      "sparse_tokens": 6715.0,
      "step": 6617,
      "turn_loss": 0.3421492874622345,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30747073034751904,
      "grad_norm": 0.5451440215110779,
      "learning_rate": 4.2661841396109505e-06,
      "loss": 0.1583,
      "mae_dtheta": 0.009797798469662666,
      "mae_dx": 0.0017075167270377278,
      "mae_dy": 0.002065062988549471,
      "pose_mae_dtheta": 0.06864223629236221,
      "pose_mae_dx": 0.015310350805521011,
      "pose_mae_dy": 0.021688032895326614,
      "pose_rmse_dtheta": 0.1903572678565979,
      "pose_rmse_dx": 0.050641704350709915,
      "pose_rmse_dy": 0.05179193988442421,
      "pose_rmse_mean": 0.09759697318077087,
      "rmse_dtheta": 0.023448532447218895,
      "rmse_dx": 0.006293424405157566,
      "rmse_dy": 0.005542393773794174,
      "rmse_mean": 0.01176145114004612,
      "rotation_flip": 0.008538899011909962,
      "sparse_tokens": 32089.0,
      "step": 6618,
      "turn_loss": 0.07287798821926117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.3075171901133618,
      "grad_norm": 0.7399848103523254,
      "learning_rate": 4.264876263593347e-06,
      "loss": 0.1697,
      "mae_dtheta": 0.03374331071972847,
      "mae_dx": 0.012170607224106789,
      "mae_dy": 0.008427581749856472,
      "pose_mae_dtheta": 0.2182849943637848,
      "pose_mae_dx": 0.09412837773561478,
      "pose_mae_dy": 0.09839240461587906,
      "pose_rmse_dtheta": 0.39649468660354614,
      "pose_rmse_dx": 0.19831177592277527,
      "pose_rmse_dy": 0.2035672515630722,
      "pose_rmse_mean": 0.26612457633018494,
      "rmse_dtheta": 0.050278209149837494,
      "rmse_dx": 0.024546196684241295,
      "rmse_dy": 0.015816746279597282,
      "rmse_mean": 0.030213719233870506,
      "rotation_flip": 0.010088272392749786,
      "sparse_tokens": 13192.0,
      "step": 6619,
      "turn_loss": 0.3088235855102539,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3075636498792046,
      "grad_norm": 0.5625357627868652,
      "learning_rate": 4.263568438983342e-06,
      "loss": 0.0899,
      "mae_dtheta": 0.009253495372831821,
      "mae_dx": 0.001686294563114643,
      "mae_dy": 0.0014804537640884519,
      "pose_mae_dtheta": 0.06527772545814514,
      "pose_mae_dx": 0.017417356371879578,
      "pose_mae_dy": 0.019373925402760506,
      "pose_rmse_dtheta": 0.20625551044940948,
      "pose_rmse_dx": 0.05299675464630127,
      "pose_rmse_dy": 0.04533875733613968,
      "pose_rmse_mean": 0.10153033584356308,
      "rmse_dtheta": 0.023900575935840607,
      "rmse_dx": 0.006360553205013275,
      "rmse_dy": 0.0032893489114940166,
      "rmse_mean": 0.011183492839336395,
      "rotation_flip": 0.001479289960116148,
      "sparse_tokens": 32073.0,
      "step": 6620,
      "turn_loss": 0.07046951353549957,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30400.0,
      "epoch": 0.30761010964504737,
      "grad_norm": 0.48574066162109375,
      "learning_rate": 4.26226066587239e-06,
      "loss": 0.1299,
      "mae_dtheta": 0.03521263226866722,
      "mae_dx": 0.013993284665048122,
      "mae_dy": 0.005916102789342403,
      "pose_mae_dtheta": 0.28773167729377747,
      "pose_mae_dx": 0.11062485724687576,
      "pose_mae_dy": 0.08307120203971863,
      "pose_rmse_dtheta": 0.5330014824867249,
      "pose_rmse_dx": 0.25289711356163025,
      "pose_rmse_dy": 0.20294013619422913,
      "pose_rmse_mean": 0.3296129107475281,
      "rmse_dtheta": 0.05519511550664902,
      "rmse_dx": 0.027904266491532326,
      "rmse_dy": 0.013413294218480587,
      "rmse_mean": 0.032170891761779785,
      "rotation_flip": 0.012066365219652653,
      "sparse_tokens": 25506.0,
      "step": 6621,
      "turn_loss": 0.2982126474380493,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.30765656941089015,
      "grad_norm": 0.5052696466445923,
      "learning_rate": 4.260952944351947e-06,
      "loss": 0.1447,
      "mae_dtheta": 0.012925082817673683,
      "mae_dx": 0.002065547276288271,
      "mae_dy": 0.002446340164169669,
      "pose_mae_dtheta": 0.09350602328777313,
      "pose_mae_dx": 0.028772005811333656,
      "pose_mae_dy": 0.03308442234992981,
      "pose_rmse_dtheta": 0.22867664694786072,
      "pose_rmse_dx": 0.07754873484373093,
      "pose_rmse_dy": 0.07958293706178665,
      "pose_rmse_mean": 0.1286027729511261,
      "rmse_dtheta": 0.02709645964205265,
      "rmse_dx": 0.005935789551585913,
      "rmse_dy": 0.005627012811601162,
      "rmse_mean": 0.012886421754956245,
      "rotation_flip": 0.006557377055287361,
      "sparse_tokens": 32121.0,
      "step": 6622,
      "turn_loss": 0.09818922728300095,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3077030291767329,
      "grad_norm": 0.4803094267845154,
      "learning_rate": 4.259645274513461e-06,
      "loss": 0.1354,
      "mae_dtheta": 0.013373630121350288,
      "mae_dx": 0.0019934664014726877,
      "mae_dy": 0.003095917636528611,
      "pose_mae_dtheta": 0.09248229116201401,
      "pose_mae_dx": 0.02465471252799034,
      "pose_mae_dy": 0.037378620356321335,
      "pose_rmse_dtheta": 0.1931331604719162,
      "pose_rmse_dx": 0.0586688369512558,
      "pose_rmse_dy": 0.08848632872104645,
      "pose_rmse_mean": 0.11342944949865341,
      "rmse_dtheta": 0.025341052561998367,
      "rmse_dx": 0.005798825528472662,
      "rmse_dy": 0.005871837958693504,
      "rmse_mean": 0.01233723945915699,
      "rotation_flip": 0.007738896179944277,
      "sparse_tokens": 32137.0,
      "step": 6623,
      "turn_loss": 0.11766277998685837,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.30774948894257576,
      "grad_norm": 1.2172298431396484,
      "learning_rate": 4.258337656448378e-06,
      "loss": 0.3722,
      "mae_dtheta": 0.05392985790967941,
      "mae_dx": 0.015063513070344925,
      "mae_dy": 0.00615607900545001,
      "pose_mae_dtheta": 0.49352937936782837,
      "pose_mae_dx": 0.14012181758880615,
      "pose_mae_dy": 0.06221954897046089,
      "pose_rmse_dtheta": 0.7499105334281921,
      "pose_rmse_dx": 0.2759842872619629,
      "pose_rmse_dy": 0.16308386623859406,
      "pose_rmse_mean": 0.3963262736797333,
      "rmse_dtheta": 0.0729188472032547,
      "rmse_dx": 0.026974791660904884,
      "rmse_dy": 0.01571238413453102,
      "rmse_mean": 0.03853534162044525,
      "rotation_flip": 0.020191285759210587,
      "sparse_tokens": 14628.0,
      "step": 6624,
      "turn_loss": 0.3615211248397827,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.30779594870841853,
      "grad_norm": 0.4411150813102722,
      "learning_rate": 4.257030090248142e-06,
      "loss": 0.096,
      "mae_dtheta": 0.027217933908104897,
      "mae_dx": 0.011712460778653622,
      "mae_dy": 0.006724505219608545,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.441115140914917,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.10694885253906,
      "model/head/act_norm_mean": 108.033349609375,
      "model/head/act_norm_min": 66.97765350341797,
      "model/head/act_over_embed": 74.24152927571679,
      "model/head/grad_frac": 0.10091868788003922,
      "model/head/grad_norm": 0.04451676085591316,
      "model/head/grad_zero_frac": 0.00016402950859628618,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.683251953125,
      "model/head/update_ratio": 0.0007597049116156995,
      "model/head/weight_delta": 9.231634140014648,
      "model/head/weight_delta_rel": 0.16195020079612732,
      "model/head/weight_norm": 58.59743881225586,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42159774899482727,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4215330430019049,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42147326469421387,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28968145360543507,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11826100945472717,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05216672271490097,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5462962962962963,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016854936257004738,
      "model/modality_embedder.encoders.pose/weight_delta": 2.978100538253784,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0973038300871849,
      "model/modality_embedder.encoders.pose/weight_norm": 30.95041275024414,
      "model/modality_embedder/grad_frac": 0.11826100945472717,
      "model/modality_embedder/grad_norm": 0.05216672271490097,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5462962962962963,
      "model/modality_embedder/update_ratio": 0.0016854936257004738,
      "model/modality_embedder/weight_delta": 2.978100538253784,
      "model/modality_embedder/weight_delta_rel": 0.0973038300871849,
      "model/modality_embedder/weight_norm": 30.95041275024414,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.34648132324219,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.51246589781746,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.998385429382324,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.157986692154054,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06856518238782883,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.030245140194892883,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001084603019990027,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.396939277648926,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0873459130525589,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.885908126831055,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 82.92594909667969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.373273189484127,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.726698875427246,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.749541521992224,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07700487226247787,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.033968016505241394,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011457508662715554,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.0401957035064697,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10531475394964218,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.646947860717773,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.6736831665039,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.02273685515873,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.06641674041748,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.88306839556595,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0923166424036026,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04072226956486702,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013303449377417564,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.2794699668884277,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11011846363544464,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.610309600830078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.6659927368164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.887344990079367,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.762619972229004,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.164444562619806,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10633101314306259,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.046904221177101135,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015710792504251003,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8036153316497803,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09581426531076431,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.854778289794922,
      "model/normalizer/grad_frac": 0.3979349136352539,
      "model/normalizer/grad_norm": 0.17553511261940002,
      "model/normalizer/grad_zero_frac": 0.0001559894735692069,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0022355723194777966,
      "model/normalizer/weight_delta": 5.931915760040283,
      "model/normalizer/weight_delta_rel": 0.07639963924884796,
      "model/normalizer/weight_norm": 78.51909637451172,
      "pose_mae_dtheta": 0.18303781747817993,
      "pose_mae_dx": 0.08431867510080338,
      "pose_mae_dy": 0.08424931019544601,
      "pose_rmse_dtheta": 0.33422642946243286,
      "pose_rmse_dx": 0.19249321520328522,
      "pose_rmse_dy": 0.21760395169258118,
      "pose_rmse_mean": 0.2481078803539276,
      "rmse_dtheta": 0.041745468974113464,
      "rmse_dx": 0.024113662540912628,
      "rmse_dy": 0.015077655203640461,
      "rmse_mean": 0.026978930458426476,
      "rotation_flip": 0.011409942992031574,
      "sparse_tokens": 21240.0,
      "step": 6625,
      "turn_loss": 0.2567389905452728,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.3078424084742613,
      "grad_norm": 0.4531034827232361,
      "learning_rate": 4.255722576004189e-06,
      "loss": 0.1227,
      "mae_dtheta": 0.006729393731802702,
      "mae_dx": 0.0014383504167199135,
      "mae_dy": 0.0007982496754266322,
      "pose_mae_dtheta": 0.047924552112817764,
      "pose_mae_dx": 0.01345959771424532,
      "pose_mae_dy": 0.012637853622436523,
      "pose_rmse_dtheta": 0.16579489409923553,
      "pose_rmse_dx": 0.028938952833414078,
      "pose_rmse_dy": 0.03649218752980232,
      "pose_rmse_mean": 0.07707534730434418,
      "rmse_dtheta": 0.020991923287510872,
      "rmse_dx": 0.003872445086017251,
      "rmse_dy": 0.0019640924874693155,
      "rmse_mean": 0.008942820131778717,
      "rotation_flip": 0.0026821636129170656,
      "sparse_tokens": 32217.0,
      "step": 6626,
      "turn_loss": 0.050251495093107224,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.3078888682401041,
      "grad_norm": 0.4288220703601837,
      "learning_rate": 4.254415113807957e-06,
      "loss": 0.096,
      "mae_dtheta": 0.04627746716141701,
      "mae_dx": 0.013011150993406773,
      "mae_dy": 0.007047907914966345,
      "pose_mae_dtheta": 0.3725176453590393,
      "pose_mae_dx": 0.10345546901226044,
      "pose_mae_dy": 0.07550082355737686,
      "pose_rmse_dtheta": 0.6231786012649536,
      "pose_rmse_dx": 0.23332402110099792,
      "pose_rmse_dy": 0.1695195585489273,
      "pose_rmse_mean": 0.3420073986053467,
      "rmse_dtheta": 0.06517447531223297,
      "rmse_dx": 0.026077982038259506,
      "rmse_dy": 0.015489977784454823,
      "rmse_mean": 0.03558081388473511,
      "rotation_flip": 0.01704035885632038,
      "sparse_tokens": 18188.0,
      "step": 6627,
      "turn_loss": 0.3786911070346832,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.30793532800594686,
      "grad_norm": 0.40301424264907837,
      "learning_rate": 4.253107703750875e-06,
      "loss": 0.0904,
      "mae_dtheta": 0.025587650015950203,
      "mae_dx": 0.008325173519551754,
      "mae_dy": 0.006232322193682194,
      "pose_mae_dtheta": 0.17215000092983246,
      "pose_mae_dx": 0.05742187052965164,
      "pose_mae_dy": 0.07128021121025085,
      "pose_rmse_dtheta": 0.3481515347957611,
      "pose_rmse_dx": 0.1330776810646057,
      "pose_rmse_dy": 0.16177865862846375,
      "pose_rmse_mean": 0.21433596312999725,
      "rmse_dtheta": 0.04439597204327583,
      "rmse_dx": 0.01932414062321186,
      "rmse_dy": 0.01197281014174223,
      "rmse_mean": 0.025230973958969116,
      "rotation_flip": 0.011264080181717873,
      "sparse_tokens": 13702.0,
      "step": 6628,
      "turn_loss": 0.19742122292518616,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.30798178777178964,
      "grad_norm": 0.6014392375946045,
      "learning_rate": 4.251800345924372e-06,
      "loss": 0.1355,
      "mae_dtheta": 0.009092298336327076,
      "mae_dx": 0.0018629408441483974,
      "mae_dy": 0.0019398967269808054,
      "pose_mae_dtheta": 0.06565095484256744,
      "pose_mae_dx": 0.02313673496246338,
      "pose_mae_dy": 0.02907705307006836,
      "pose_rmse_dtheta": 0.13779236376285553,
      "pose_rmse_dx": 0.0638677328824997,
      "pose_rmse_dy": 0.07651187479496002,
      "pose_rmse_mean": 0.09272398799657822,
      "rmse_dtheta": 0.018692463636398315,
      "rmse_dx": 0.0062757632695138454,
      "rmse_dy": 0.004209125880151987,
      "rmse_mean": 0.009725784882903099,
      "rotation_flip": 0.004189359024167061,
      "sparse_tokens": 32121.0,
      "step": 6629,
      "turn_loss": 0.07863492518663406,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3080282475376324,
      "grad_norm": 0.39449918270111084,
      "learning_rate": 4.250493040419874e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.012554487213492393,
      "mae_dx": 0.002187201986089349,
      "mae_dy": 0.0022733090445399284,
      "pose_mae_dtheta": 0.09220874309539795,
      "pose_mae_dx": 0.02642027474939823,
      "pose_mae_dy": 0.028171434998512268,
      "pose_rmse_dtheta": 0.2524804472923279,
      "pose_rmse_dx": 0.06614526361227036,
      "pose_rmse_dy": 0.07307794690132141,
      "pose_rmse_mean": 0.13056789338588715,
      "rmse_dtheta": 0.029093263670802116,
      "rmse_dx": 0.005847124382853508,
      "rmse_dy": 0.005365453194826841,
      "rmse_mean": 0.01343528088182211,
      "rotation_flip": 0.006402560975402594,
      "sparse_tokens": 32153.0,
      "step": 6630,
      "turn_loss": 0.08736228942871094,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3080747073034752,
      "grad_norm": 0.5340235233306885,
      "learning_rate": 4.249185787328798e-06,
      "loss": 0.1015,
      "mae_dtheta": 0.012209533713757992,
      "mae_dx": 0.0018297276692464948,
      "mae_dy": 0.002153690904378891,
      "pose_mae_dtheta": 0.09614712744951248,
      "pose_mae_dx": 0.024534547701478004,
      "pose_mae_dy": 0.0327463299036026,
      "pose_rmse_dtheta": 0.2629067301750183,
      "pose_rmse_dx": 0.07545406371355057,
      "pose_rmse_dy": 0.08921600133180618,
      "pose_rmse_mean": 0.1425255984067917,
      "rmse_dtheta": 0.028382418677210808,
      "rmse_dx": 0.005478246137499809,
      "rmse_dy": 0.005277499556541443,
      "rmse_mean": 0.013046055100858212,
      "rotation_flip": 0.004205214325338602,
      "sparse_tokens": 32121.0,
      "step": 6631,
      "turn_loss": 0.07709911465644836,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.30812116706931797,
      "grad_norm": 0.4571099281311035,
      "learning_rate": 4.2478785867425655e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.04140419140458107,
      "mae_dx": 0.013431433588266373,
      "mae_dy": 0.005116954445838928,
      "pose_mae_dtheta": 0.34742963314056396,
      "pose_mae_dx": 0.1067597046494484,
      "pose_mae_dy": 0.055339936167001724,
      "pose_rmse_dtheta": 0.5957608222961426,
      "pose_rmse_dx": 0.23749716579914093,
      "pose_rmse_dy": 0.12961642444133759,
      "pose_rmse_mean": 0.32095813751220703,
      "rmse_dtheta": 0.060388389974832535,
      "rmse_dx": 0.0261447262018919,
      "rmse_dy": 0.009112106636166573,
      "rmse_mean": 0.03188174217939377,
      "rotation_flip": 0.016990290954709053,
      "sparse_tokens": 7265.0,
      "step": 6632,
      "turn_loss": 0.2636863589286804,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.30816762683516075,
      "grad_norm": 0.4235002100467682,
      "learning_rate": 4.246571438752585e-06,
      "loss": 0.1042,
      "mae_dtheta": 0.010707844980061054,
      "mae_dx": 0.0017407333943992853,
      "mae_dy": 0.003295992035418749,
      "pose_mae_dtheta": 0.06910497695207596,
      "pose_mae_dx": 0.030108919367194176,
      "pose_mae_dy": 0.034912481904029846,
      "pose_rmse_dtheta": 0.14390628039836884,
      "pose_rmse_dx": 0.07105737179517746,
      "pose_rmse_dy": 0.07405796647071838,
      "pose_rmse_mean": 0.09634053707122803,
      "rmse_dtheta": 0.021221427246928215,
      "rmse_dx": 0.0043151783756911755,
      "rmse_dy": 0.006508421618491411,
      "rmse_mean": 0.010681676678359509,
      "rotation_flip": 0.004379562102258205,
      "sparse_tokens": 32105.0,
      "step": 6633,
      "turn_loss": 0.09366197139024734,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3082140866010035,
      "grad_norm": 0.6816590428352356,
      "learning_rate": 4.24526434345027e-06,
      "loss": 0.124,
      "mae_dtheta": 0.006709340959787369,
      "mae_dx": 0.0015496041160076857,
      "mae_dy": 0.0014722588239237666,
      "pose_mae_dtheta": 0.04714353382587433,
      "pose_mae_dx": 0.019699910655617714,
      "pose_mae_dy": 0.01555889006704092,
      "pose_rmse_dtheta": 0.16880279779434204,
      "pose_rmse_dx": 0.06286878138780594,
      "pose_rmse_dy": 0.044856470078229904,
      "pose_rmse_mean": 0.09217601269483566,
      "rmse_dtheta": 0.020993372425436974,
      "rmse_dx": 0.005628830287605524,
      "rmse_dy": 0.004043675493448973,
      "rmse_mean": 0.01022196002304554,
      "rotation_flip": 0.0025252525229007006,
      "sparse_tokens": 32057.0,
      "step": 6634,
      "turn_loss": 0.0480390302836895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36550.0,
      "epoch": 0.3082605463668463,
      "grad_norm": 0.4382229447364807,
      "learning_rate": 4.243957300927022e-06,
      "loss": 0.1306,
      "mae_dtheta": 0.038600433617830276,
      "mae_dx": 0.012963461689651012,
      "mae_dy": 0.007512724492698908,
      "pose_mae_dtheta": 0.325968474149704,
      "pose_mae_dx": 0.12889550626277924,
      "pose_mae_dy": 0.08848145604133606,
      "pose_rmse_dtheta": 0.5586237907409668,
      "pose_rmse_dx": 0.2809370458126068,
      "pose_rmse_dy": 0.2005145251750946,
      "pose_rmse_mean": 0.3466918170452118,
      "rmse_dtheta": 0.057727355509996414,
      "rmse_dx": 0.02653808891773224,
      "rmse_dy": 0.016825756058096886,
      "rmse_mean": 0.03369706869125366,
      "rotation_flip": 0.014324693009257317,
      "sparse_tokens": 26902.0,
      "step": 6635,
      "turn_loss": 0.3486735224723816,
      "turns": 113.0,
      "turns_per_sample": 113.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3083070061326891,
      "grad_norm": 0.6873323917388916,
      "learning_rate": 4.242650311274246e-06,
      "loss": 0.1784,
      "mae_dtheta": 0.011288695968687534,
      "mae_dx": 0.002662869170308113,
      "mae_dy": 0.0031546263489872217,
      "pose_mae_dtheta": 0.08064281195402145,
      "pose_mae_dx": 0.029450898990035057,
      "pose_mae_dy": 0.03130653500556946,
      "pose_rmse_dtheta": 0.20107269287109375,
      "pose_rmse_dx": 0.09112223982810974,
      "pose_rmse_dy": 0.08724691718816757,
      "pose_rmse_mean": 0.12648062407970428,
      "rmse_dtheta": 0.02626947872340679,
      "rmse_dx": 0.007849525660276413,
      "rmse_dy": 0.008660460822284222,
      "rmse_mean": 0.014259821735322475,
      "rotation_flip": 0.005527043249458075,
      "sparse_tokens": 32137.0,
      "step": 6636,
      "turn_loss": 0.1132800430059433,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.30835346589853185,
      "grad_norm": 0.4773581326007843,
      "learning_rate": 4.241343374583343e-06,
      "loss": 0.0802,
      "mae_dtheta": 0.007217292673885822,
      "mae_dx": 0.001210335292853415,
      "mae_dy": 0.0011517039965838194,
      "pose_mae_dtheta": 0.05332206189632416,
      "pose_mae_dx": 0.013721926137804985,
      "pose_mae_dy": 0.01960528828203678,
      "pose_rmse_dtheta": 0.15643242001533508,
      "pose_rmse_dx": 0.03615916520357132,
      "pose_rmse_dy": 0.05028994381427765,
      "pose_rmse_mean": 0.08096051216125488,
      "rmse_dtheta": 0.01939167082309723,
      "rmse_dx": 0.004254880826920271,
      "rmse_dy": 0.0024647864047437906,
      "rmse_mean": 0.008703779429197311,
      "rotation_flip": 0.0039548021741211414,
      "sparse_tokens": 32073.0,
      "step": 6637,
      "turn_loss": 0.05780808627605438,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.30839992566437463,
      "grad_norm": 0.547377347946167,
      "learning_rate": 4.240036490945702e-06,
      "loss": 0.1575,
      "mae_dtheta": 0.03869534283876419,
      "mae_dx": 0.010542319156229496,
      "mae_dy": 0.004572045523673296,
      "pose_mae_dtheta": 0.34433791041374207,
      "pose_mae_dx": 0.06829233467578888,
      "pose_mae_dy": 0.06638748198747635,
      "pose_rmse_dtheta": 0.6565708518028259,
      "pose_rmse_dx": 0.16012533009052277,
      "pose_rmse_dy": 0.1658211350440979,
      "pose_rmse_mean": 0.32750576734542847,
      "rmse_dtheta": 0.06132722645998001,
      "rmse_dx": 0.023120228201150894,
      "rmse_dy": 0.009143508039414883,
      "rmse_mean": 0.031196989119052887,
      "rotation_flip": 0.014367816038429737,
      "sparse_tokens": 5605.0,
      "step": 6638,
      "turn_loss": 0.23459479212760925,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 25959.0,
      "epoch": 0.3084463854302174,
      "grad_norm": 0.450643926858902,
      "learning_rate": 4.23872966045272e-06,
      "loss": 0.1107,
      "mae_dtheta": 0.03472450375556946,
      "mae_dx": 0.009532153606414795,
      "mae_dy": 0.004308374598622322,
      "pose_mae_dtheta": 0.25086304545402527,
      "pose_mae_dx": 0.0690484493970871,
      "pose_mae_dy": 0.042986441403627396,
      "pose_rmse_dtheta": 0.5010054111480713,
      "pose_rmse_dx": 0.16150283813476562,
      "pose_rmse_dy": 0.10935115069150925,
      "pose_rmse_mean": 0.2572864890098572,
      "rmse_dtheta": 0.05684470012784004,
      "rmse_dx": 0.02093718945980072,
      "rmse_dy": 0.009777942672371864,
      "rmse_mean": 0.029186610132455826,
      "rotation_flip": 0.021915584802627563,
      "sparse_tokens": 20143.0,
      "step": 6639,
      "turn_loss": 0.2287742644548416,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.30849284519606024,
      "grad_norm": 0.5115401744842529,
      "learning_rate": 4.2374228831957785e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.02794741280376911,
      "mae_dx": 0.01081619132310152,
      "mae_dy": 0.006151943933218718,
      "pose_mae_dtheta": 0.2286282777786255,
      "pose_mae_dx": 0.11544182896614075,
      "pose_mae_dy": 0.09181287884712219,
      "pose_rmse_dtheta": 0.44679126143455505,
      "pose_rmse_dx": 0.2897292375564575,
      "pose_rmse_dy": 0.23151206970214844,
      "pose_rmse_mean": 0.3226775527000427,
      "rmse_dtheta": 0.046784110367298126,
      "rmse_dx": 0.026159822940826416,
      "rmse_dy": 0.014069383032619953,
      "rmse_mean": 0.02900443971157074,
      "rotation_flip": 0.011965812183916569,
      "sparse_tokens": 12327.0,
      "step": 6640,
      "turn_loss": 0.218429297208786,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.308539304961903,
      "grad_norm": 0.413009911775589,
      "learning_rate": 4.2361161592662655e-06,
      "loss": 0.1058,
      "mae_dtheta": 0.04076997935771942,
      "mae_dx": 0.009993175975978374,
      "mae_dy": 0.013246389105916023,
      "pose_mae_dtheta": 0.3861554265022278,
      "pose_mae_dx": 0.11307554692029953,
      "pose_mae_dy": 0.17655779421329498,
      "pose_rmse_dtheta": 0.6222733855247498,
      "pose_rmse_dx": 0.21204927563667297,
      "pose_rmse_dy": 0.3460926115512848,
      "pose_rmse_mean": 0.39347177743911743,
      "rmse_dtheta": 0.05697919800877571,
      "rmse_dx": 0.02010154165327549,
      "rmse_dy": 0.022835606709122658,
      "rmse_mean": 0.03330545127391815,
      "rotation_flip": 0.011363636702299118,
      "sparse_tokens": 3116.0,
      "step": 6641,
      "turn_loss": 0.3331049680709839,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.3085857647277458,
      "grad_norm": 0.9372162818908691,
      "learning_rate": 4.234809488755559e-06,
      "loss": 0.2758,
      "mae_dtheta": 0.034702450037002563,
      "mae_dx": 0.011279386468231678,
      "mae_dy": 0.005345894023776054,
      "pose_mae_dtheta": 0.26574933528900146,
      "pose_mae_dx": 0.08133963495492935,
      "pose_mae_dy": 0.054442789405584335,
      "pose_rmse_dtheta": 0.49555566906929016,
      "pose_rmse_dx": 0.17527860403060913,
      "pose_rmse_dy": 0.1332121193408966,
      "pose_rmse_mean": 0.26801547408103943,
      "rmse_dtheta": 0.05355836823582649,
      "rmse_dx": 0.022604485973715782,
      "rmse_dy": 0.011581316590309143,
      "rmse_mean": 0.029248056933283806,
      "rotation_flip": 0.011848341673612595,
      "sparse_tokens": 20616.0,
      "step": 6642,
      "turn_loss": 0.3191383481025696,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 35578.0,
      "epoch": 0.30863222449358857,
      "grad_norm": 0.5096721053123474,
      "learning_rate": 4.233502871755036e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.03739960119128227,
      "mae_dx": 0.014661330729722977,
      "mae_dy": 0.005469812545925379,
      "pose_mae_dtheta": 0.3363524377346039,
      "pose_mae_dx": 0.11508503556251526,
      "pose_mae_dy": 0.06707823276519775,
      "pose_rmse_dtheta": 0.5613495111465454,
      "pose_rmse_dx": 0.24907994270324707,
      "pose_rmse_dy": 0.17976297438144684,
      "pose_rmse_mean": 0.33006414771080017,
      "rmse_dtheta": 0.054999928921461105,
      "rmse_dx": 0.02772379480302334,
      "rmse_dy": 0.012645719572901726,
      "rmse_mean": 0.03178981691598892,
      "rotation_flip": 0.013973268680274487,
      "sparse_tokens": 27111.0,
      "step": 6643,
      "turn_loss": 0.26444530487060547,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.30867868425943135,
      "grad_norm": 0.3578248918056488,
      "learning_rate": 4.23219630835607e-06,
      "loss": 0.0638,
      "mae_dtheta": 0.006636657286435366,
      "mae_dx": 0.0010906601091846824,
      "mae_dy": 0.0001814900169847533,
      "pose_mae_dtheta": 0.04410447180271149,
      "pose_mae_dx": 0.008080888539552689,
      "pose_mae_dy": 0.0038081964012235403,
      "pose_rmse_dtheta": 0.19544652104377747,
      "pose_rmse_dx": 0.020069193094968796,
      "pose_rmse_dy": 0.007110993843525648,
      "pose_rmse_mean": 0.07420890778303146,
      "rmse_dtheta": 0.02674066089093685,
      "rmse_dx": 0.0034277429804205894,
      "rmse_dy": 0.000285208981949836,
      "rmse_mean": 0.010151203721761703,
      "rotation_flip": 0.003433476435020566,
      "sparse_tokens": 32137.0,
      "step": 6644,
      "turn_loss": 0.031646162271499634,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.3087251440252741,
      "grad_norm": 0.6755550503730774,
      "learning_rate": 4.230889798650027e-06,
      "loss": 0.0839,
      "mae_dtheta": 0.04628326743841171,
      "mae_dx": 0.011692007072269917,
      "mae_dy": 0.002377214143052697,
      "pose_mae_dtheta": 0.3907158076763153,
      "pose_mae_dx": 0.0941043421626091,
      "pose_mae_dy": 0.029580488801002502,
      "pose_rmse_dtheta": 0.6683076620101929,
      "pose_rmse_dx": 0.1983237862586975,
      "pose_rmse_dy": 0.10011734813451767,
      "pose_rmse_mean": 0.3222495913505554,
      "rmse_dtheta": 0.0686265230178833,
      "rmse_dx": 0.02371048554778099,
      "rmse_dy": 0.005342467222362757,
      "rmse_mean": 0.0325598269701004,
      "rotation_flip": 0.011627906933426857,
      "sparse_tokens": 6373.0,
      "step": 6645,
      "turn_loss": 0.23695863783359528,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3087716037911169,
      "grad_norm": 0.38505294919013977,
      "learning_rate": 4.229583342728273e-06,
      "loss": 0.0825,
      "mae_dtheta": 0.007301753852516413,
      "mae_dx": 0.001088694203644991,
      "mae_dy": 0.0011565887834876776,
      "pose_mae_dtheta": 0.05041404440999031,
      "pose_mae_dx": 0.013299376703798771,
      "pose_mae_dy": 0.016323048621416092,
      "pose_rmse_dtheta": 0.15437813103199005,
      "pose_rmse_dx": 0.0457460843026638,
      "pose_rmse_dy": 0.03959483653306961,
      "pose_rmse_mean": 0.07990635931491852,
      "rmse_dtheta": 0.019939249381422997,
      "rmse_dx": 0.004848985932767391,
      "rmse_dy": 0.002617977559566498,
      "rmse_mean": 0.009135404601693153,
      "rotation_flip": 0.0027995521668344736,
      "sparse_tokens": 32057.0,
      "step": 6646,
      "turn_loss": 0.05023153871297836,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.3088180635569597,
      "grad_norm": 0.7136543989181519,
      "learning_rate": 4.228276940682169e-06,
      "loss": 0.1532,
      "mae_dtheta": 0.042175330221652985,
      "mae_dx": 0.007314563263207674,
      "mae_dy": 0.0129103884100914,
      "pose_mae_dtheta": 0.3491605520248413,
      "pose_mae_dx": 0.03533680737018585,
      "pose_mae_dy": 0.08705539256334305,
      "pose_rmse_dtheta": 0.5698893070220947,
      "pose_rmse_dx": 0.07166265696287155,
      "pose_rmse_dy": 0.21736808121204376,
      "pose_rmse_mean": 0.2863066792488098,
      "rmse_dtheta": 0.06455636769533157,
      "rmse_dx": 0.014211428351700306,
      "rmse_dy": 0.025205187499523163,
      "rmse_mean": 0.034657664597034454,
      "rotation_flip": 0.006802720949053764,
      "sparse_tokens": 2634.0,
      "step": 6647,
      "turn_loss": 0.4658166170120239,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.30886452332280245,
      "grad_norm": 0.41123679280281067,
      "learning_rate": 4.226970592603073e-06,
      "loss": 0.0689,
      "mae_dtheta": 0.00425555557012558,
      "mae_dx": 0.0015518652508035302,
      "mae_dy": 0.00033285171957686543,
      "pose_mae_dtheta": 0.03085930459201336,
      "pose_mae_dx": 0.012070045806467533,
      "pose_mae_dy": 0.00417941901832819,
      "pose_rmse_dtheta": 0.1324593871831894,
      "pose_rmse_dx": 0.03826037421822548,
      "pose_rmse_dy": 0.010920706205070019,
      "pose_rmse_mean": 0.06054682284593582,
      "rmse_dtheta": 0.016698267310857773,
      "rmse_dx": 0.00555008789524436,
      "rmse_dy": 0.0007879370823502541,
      "rmse_mean": 0.007678764872252941,
      "rotation_flip": 0.002281368710100651,
      "sparse_tokens": 32153.0,
      "step": 6648,
      "turn_loss": 0.03426650911569595,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.30891098308864523,
      "grad_norm": 0.42966774106025696,
      "learning_rate": 4.225664298582339e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.023865921422839165,
      "mae_dx": 0.007785137742757797,
      "mae_dy": 0.0084694167599082,
      "pose_mae_dtheta": 0.17087572813034058,
      "pose_mae_dx": 0.06259338557720184,
      "pose_mae_dy": 0.08194378763437271,
      "pose_rmse_dtheta": 0.36583662033081055,
      "pose_rmse_dx": 0.16564702987670898,
      "pose_rmse_dy": 0.2425612211227417,
      "pose_rmse_mean": 0.258014976978302,
      "rmse_dtheta": 0.043747883290052414,
      "rmse_dx": 0.01898208260536194,
      "rmse_dy": 0.01963917911052704,
      "rmse_mean": 0.027456384152173996,
      "rotation_flip": 0.005988024175167084,
      "sparse_tokens": 7133.0,
      "step": 6649,
      "turn_loss": 0.2510185241699219,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.308957442854488,
      "grad_norm": 0.42740294337272644,
      "learning_rate": 4.224358058711314e-06,
      "loss": 0.1482,
      "mae_dtheta": 0.012815801426768303,
      "mae_dx": 0.0017978515243157744,
      "mae_dy": 0.0036907210014760494,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.42740294337272644,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.59458923339844,
      "model/head/act_norm_mean": 103.25297900883838,
      "model/head/act_norm_min": 61.58717727661133,
      "model/head/act_over_embed": 70.95641384449334,
      "model/head/grad_frac": 0.1246233582496643,
      "model/head/grad_norm": 0.05326439067721367,
      "model/head/grad_zero_frac": 0.0001884594385046512,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7070213857323232,
      "model/head/update_ratio": 0.0009089586092159152,
      "model/head/weight_delta": 9.242090225219727,
      "model/head/weight_delta_rel": 0.16213363409042358,
      "model/head/weight_norm": 58.59935760498047,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42155909538269043,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4214855929661225,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42140743136405945,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28964884549661113,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09251110255718231,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03953951597213745,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5290779147982063,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001277488307096064,
      "model/modality_embedder.encoders.pose/weight_delta": 2.981947422027588,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09742951393127441,
      "model/modality_embedder.encoders.pose/weight_norm": 30.95098114013672,
      "model/modality_embedder/grad_frac": 0.09251110255718231,
      "model/modality_embedder/grad_norm": 0.03953951597213745,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5290779147982063,
      "model/modality_embedder/update_ratio": 0.001277488307096064,
      "model/modality_embedder/weight_delta": 2.981947422027588,
      "model/modality_embedder/weight_delta_rel": 0.09742951393127441,
      "model/modality_embedder/weight_norm": 30.95098114013672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.88523864746094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.99452861952862,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.137689590454102,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.802055345508766,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07340312004089355,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.031372711062431335,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002975710085593164,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011250026291236281,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4014720916748047,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0875110924243927,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.886789321899414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.75387573242188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.998461800545133,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.38084888458252,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.491967626473837,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08030134439468384,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03432103246450424,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.00115761358756572,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.0453453063964844,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10549314320087433,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.648090362548828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.44403076171875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.895783229116564,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.87527084350586,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.795824675191202,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08223403245210648,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03514706715941429,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011481766123324633,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.2852890491485596,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11031385511159897,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.611202239990234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.23534393310547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.73167187750521,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.260452270507812,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.057464542224203,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0821140855550766,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03509580343961716,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001175513258203864,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.808774471282959,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09599058330059052,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.85572624206543,
      "model/normalizer/grad_frac": 0.29713988304138184,
      "model/normalizer/grad_norm": 0.12699845433235168,
      "model/normalizer/grad_zero_frac": 0.00028125374228693545,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016173959011211991,
      "model/normalizer/weight_delta": 5.942476749420166,
      "model/normalizer/weight_delta_rel": 0.0765356570482254,
      "model/normalizer/weight_norm": 78.52032470703125,
      "pose_mae_dtheta": 0.08588714152574539,
      "pose_mae_dx": 0.02947499044239521,
      "pose_mae_dy": 0.0357833169400692,
      "pose_rmse_dtheta": 0.19496339559555054,
      "pose_rmse_dx": 0.07017571479082108,
      "pose_rmse_dy": 0.07368366420269012,
      "pose_rmse_mean": 0.11294092983007431,
      "rmse_dtheta": 0.02492949366569519,
      "rmse_dx": 0.004499590024352074,
      "rmse_dy": 0.007050690241158009,
      "rmse_mean": 0.012159924954175949,
      "rotation_flip": 0.005739795975387096,
      "sparse_tokens": 32105.0,
      "step": 6650,
      "turn_loss": 0.10322768241167068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.3090039026203308,
      "grad_norm": 0.46670493483543396,
      "learning_rate": 4.2230518730813495e-06,
      "loss": 0.1391,
      "mae_dtheta": 0.05603734776377678,
      "mae_dx": 0.01500610914081335,
      "mae_dy": 0.009436060674488544,
      "pose_mae_dtheta": 0.5138830542564392,
      "pose_mae_dx": 0.12403319776058197,
      "pose_mae_dy": 0.10952829569578171,
      "pose_rmse_dtheta": 0.7561938762664795,
      "pose_rmse_dx": 0.25293755531311035,
      "pose_rmse_dy": 0.27191483974456787,
      "pose_rmse_mean": 0.42701542377471924,
      "rmse_dtheta": 0.07379405200481415,
      "rmse_dx": 0.02673741616308689,
      "rmse_dy": 0.020744383335113525,
      "rmse_mean": 0.04042528569698334,
      "rotation_flip": 0.0243055559694767,
      "sparse_tokens": 9054.0,
      "step": 6651,
      "turn_loss": 0.4516640603542328,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.30905036238617356,
      "grad_norm": 0.51780104637146,
      "learning_rate": 4.221745741783783e-06,
      "loss": 0.1528,
      "mae_dtheta": 0.03277157247066498,
      "mae_dx": 0.009839417412877083,
      "mae_dy": 0.005096381064504385,
      "pose_mae_dtheta": 0.2539074420928955,
      "pose_mae_dx": 0.08848390728235245,
      "pose_mae_dy": 0.05211605504155159,
      "pose_rmse_dtheta": 0.4499428868293762,
      "pose_rmse_dx": 0.20116586983203888,
      "pose_rmse_dy": 0.14016540348529816,
      "pose_rmse_mean": 0.2637580633163452,
      "rmse_dtheta": 0.05099007114768028,
      "rmse_dx": 0.021449878811836243,
      "rmse_dy": 0.010635875165462494,
      "rmse_mean": 0.02769194357097149,
      "rotation_flip": 0.012690355069935322,
      "sparse_tokens": 15579.0,
      "step": 6652,
      "turn_loss": 0.2655192017555237,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.30909682215201634,
      "grad_norm": 0.42356178164482117,
      "learning_rate": 4.220439664909956e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.011179430410265923,
      "mae_dx": 0.0025054696016013622,
      "mae_dy": 0.0034229771699756384,
      "pose_mae_dtheta": 0.07997692376375198,
      "pose_mae_dx": 0.031888239085674286,
      "pose_mae_dy": 0.035816535353660583,
      "pose_rmse_dtheta": 0.18416213989257812,
      "pose_rmse_dx": 0.0797937661409378,
      "pose_rmse_dy": 0.07629778981208801,
      "pose_rmse_mean": 0.11341789364814758,
      "rmse_dtheta": 0.023692209273576736,
      "rmse_dx": 0.007134361192584038,
      "rmse_dy": 0.007208984345197678,
      "rmse_mean": 0.012678518891334534,
      "rotation_flip": 0.0063241105526685715,
      "sparse_tokens": 32105.0,
      "step": 6653,
      "turn_loss": 0.10637029260396957,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3091432819178591,
      "grad_norm": 0.3132674992084503,
      "learning_rate": 4.219133642551199e-06,
      "loss": 0.0813,
      "mae_dtheta": 0.007764427922666073,
      "mae_dx": 0.0010497047333046794,
      "mae_dy": 0.0012557049049064517,
      "pose_mae_dtheta": 0.05407705903053284,
      "pose_mae_dx": 0.013073512353003025,
      "pose_mae_dy": 0.02038716711103916,
      "pose_rmse_dtheta": 0.17606917023658752,
      "pose_rmse_dx": 0.0409814827144146,
      "pose_rmse_dy": 0.057710446417331696,
      "pose_rmse_mean": 0.09158703684806824,
      "rmse_dtheta": 0.022262685000896454,
      "rmse_dx": 0.0042602624744176865,
      "rmse_dy": 0.0033517293632030487,
      "rmse_mean": 0.00995822623372078,
      "rotation_flip": 0.0027457440737634897,
      "sparse_tokens": 32057.0,
      "step": 6654,
      "turn_loss": 0.053772155195474625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3091897416837019,
      "grad_norm": 0.4461670517921448,
      "learning_rate": 4.217827674798845e-06,
      "loss": 0.0952,
      "mae_dtheta": 0.01053562480956316,
      "mae_dx": 0.0017652129754424095,
      "mae_dy": 0.002313985489308834,
      "pose_mae_dtheta": 0.06930127739906311,
      "pose_mae_dx": 0.020315954461693764,
      "pose_mae_dy": 0.020346995443105698,
      "pose_rmse_dtheta": 0.23021557927131653,
      "pose_rmse_dx": 0.06265042722225189,
      "pose_rmse_dy": 0.04519469290971756,
      "pose_rmse_mean": 0.1126868948340416,
      "rmse_dtheta": 0.026230353862047195,
      "rmse_dx": 0.004865062888711691,
      "rmse_dy": 0.005604522302746773,
      "rmse_mean": 0.012233313173055649,
      "rotation_flip": 0.006545454729348421,
      "sparse_tokens": 32121.0,
      "step": 6655,
      "turn_loss": 0.07644469290971756,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.30923620144954467,
      "grad_norm": 0.4539515972137451,
      "learning_rate": 4.216521761744224e-06,
      "loss": 0.1142,
      "mae_dtheta": 0.03432576358318329,
      "mae_dx": 0.012610216625034809,
      "mae_dy": 0.008940321393311024,
      "pose_mae_dtheta": 0.260872483253479,
      "pose_mae_dx": 0.11882731318473816,
      "pose_mae_dy": 0.07413393259048462,
      "pose_rmse_dtheta": 0.45042338967323303,
      "pose_rmse_dx": 0.25301700830459595,
      "pose_rmse_dy": 0.192316934466362,
      "pose_rmse_mean": 0.29858580231666565,
      "rmse_dtheta": 0.05310528352856636,
      "rmse_dx": 0.024567365646362305,
      "rmse_dy": 0.019659286364912987,
      "rmse_mean": 0.032443977892398834,
      "rotation_flip": 0.010678871534764767,
      "sparse_tokens": 23350.0,
      "step": 6656,
      "turn_loss": 0.3686909079551697,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3092826612153875,
      "grad_norm": 0.4929240942001343,
      "learning_rate": 4.2152159034786554e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.0146169513463974,
      "mae_dx": 0.0021251344587653875,
      "mae_dy": 0.0034452045802026987,
      "pose_mae_dtheta": 0.10676064342260361,
      "pose_mae_dx": 0.023292502388358116,
      "pose_mae_dy": 0.03387758880853653,
      "pose_rmse_dtheta": 0.2658793032169342,
      "pose_rmse_dx": 0.06207894906401634,
      "pose_rmse_dy": 0.08205430209636688,
      "pose_rmse_mean": 0.13667085766792297,
      "rmse_dtheta": 0.03026331029832363,
      "rmse_dx": 0.006387841422110796,
      "rmse_dy": 0.007750980090349913,
      "rmse_mean": 0.014800711534917355,
      "rotation_flip": 0.006224825978279114,
      "sparse_tokens": 32089.0,
      "step": 6657,
      "turn_loss": 0.1085611954331398,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.3093291209812303,
      "grad_norm": 0.5649958848953247,
      "learning_rate": 4.213910100093462e-06,
      "loss": 0.1998,
      "mae_dtheta": 0.03817160800099373,
      "mae_dx": 0.010277930647134781,
      "mae_dy": 0.0049074566923081875,
      "pose_mae_dtheta": 0.30908203125,
      "pose_mae_dx": 0.08160081505775452,
      "pose_mae_dy": 0.058498628437519073,
      "pose_rmse_dtheta": 0.5351635813713074,
      "pose_rmse_dx": 0.1808144748210907,
      "pose_rmse_dy": 0.1378394216299057,
      "pose_rmse_mean": 0.28460583090782166,
      "rmse_dtheta": 0.057189445942640305,
      "rmse_dx": 0.021336283534765244,
      "rmse_dy": 0.01093915943056345,
      "rmse_mean": 0.02982163056731224,
      "rotation_flip": 0.013764624483883381,
      "sparse_tokens": 21347.0,
      "step": 6658,
      "turn_loss": 0.2837044298648834,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.30937558074707305,
      "grad_norm": 0.4130484461784363,
      "learning_rate": 4.212604351679954e-06,
      "loss": 0.1301,
      "mae_dtheta": 0.023955678567290306,
      "mae_dx": 0.0038185890298336744,
      "mae_dy": 0.004135183524340391,
      "pose_mae_dtheta": 0.15416522324085236,
      "pose_mae_dx": 0.026539050042629242,
      "pose_mae_dy": 0.06156105175614357,
      "pose_rmse_dtheta": 0.33116427063941956,
      "pose_rmse_dx": 0.057243846356868744,
      "pose_rmse_dy": 0.1496196836233139,
      "pose_rmse_mean": 0.1793426126241684,
      "rmse_dtheta": 0.04318520054221153,
      "rmse_dx": 0.010391353629529476,
      "rmse_dy": 0.010653932578861713,
      "rmse_mean": 0.02141016349196434,
      "rotation_flip": 0.015197568573057652,
      "sparse_tokens": 4933.0,
      "step": 6659,
      "turn_loss": 0.2208193838596344,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.30942204051291583,
      "grad_norm": 0.5001571774482727,
      "learning_rate": 4.21129865832945e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.01198066957294941,
      "mae_dx": 0.0033971178345382214,
      "mae_dy": 0.0036699604243040085,
      "pose_mae_dtheta": 0.08224020153284073,
      "pose_mae_dx": 0.03655677288770676,
      "pose_mae_dy": 0.03278715908527374,
      "pose_rmse_dtheta": 0.18981392681598663,
      "pose_rmse_dx": 0.10295965522527695,
      "pose_rmse_dy": 0.07341630756855011,
      "pose_rmse_mean": 0.1220633015036583,
      "rmse_dtheta": 0.024721091613173485,
      "rmse_dx": 0.00895337201654911,
      "rmse_dy": 0.00843172986060381,
      "rmse_mean": 0.01403539814054966,
      "rotation_flip": 0.004360465332865715,
      "sparse_tokens": 32153.0,
      "step": 6660,
      "turn_loss": 0.11884617060422897,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.3094685002787586,
      "grad_norm": 0.5458871126174927,
      "learning_rate": 4.209993020133251e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.04497568681836128,
      "mae_dx": 0.009646161459386349,
      "mae_dy": 0.004104661755263805,
      "pose_mae_dtheta": 0.3659789562225342,
      "pose_mae_dx": 0.07096301019191742,
      "pose_mae_dy": 0.058849405497312546,
      "pose_rmse_dtheta": 0.6071383357048035,
      "pose_rmse_dx": 0.14844129979610443,
      "pose_rmse_dy": 0.1428317278623581,
      "pose_rmse_mean": 0.2994704842567444,
      "rmse_dtheta": 0.06237560510635376,
      "rmse_dx": 0.01932857744395733,
      "rmse_dy": 0.00832879263907671,
      "rmse_mean": 0.030010994523763657,
      "rotation_flip": 0.016853932291269302,
      "sparse_tokens": 6248.0,
      "step": 6661,
      "turn_loss": 0.26730048656463623,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3095149600446014,
      "grad_norm": 0.5604123473167419,
      "learning_rate": 4.208687437182665e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.008971096016466618,
      "mae_dx": 0.0014710716204717755,
      "mae_dy": 0.0017978957621380687,
      "pose_mae_dtheta": 0.059182196855545044,
      "pose_mae_dx": 0.018360119313001633,
      "pose_mae_dy": 0.018526745960116386,
      "pose_rmse_dtheta": 0.16960866749286652,
      "pose_rmse_dx": 0.0443444699048996,
      "pose_rmse_dy": 0.04584047943353653,
      "pose_rmse_mean": 0.08659787476062775,
      "rmse_dtheta": 0.022276895120739937,
      "rmse_dx": 0.003829222172498703,
      "rmse_dy": 0.004085426218807697,
      "rmse_mean": 0.010063848458230495,
      "rotation_flip": 0.005179557949304581,
      "sparse_tokens": 32185.0,
      "step": 6662,
      "turn_loss": 0.06925570219755173,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.30956141981044416,
      "grad_norm": 0.5696885585784912,
      "learning_rate": 4.207381909568993e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.014119857922196388,
      "mae_dx": 0.004759958013892174,
      "mae_dy": 0.0034051600378006697,
      "pose_mae_dtheta": 0.09174343943595886,
      "pose_mae_dx": 0.047943152487277985,
      "pose_mae_dy": 0.04918743297457695,
      "pose_rmse_dtheta": 0.20331422984600067,
      "pose_rmse_dx": 0.1134614571928978,
      "pose_rmse_dy": 0.11243290454149246,
      "pose_rmse_mean": 0.1430695354938507,
      "rmse_dtheta": 0.026933256536722183,
      "rmse_dx": 0.013536440208554268,
      "rmse_dy": 0.006671771872788668,
      "rmse_mean": 0.015713823959231377,
      "rotation_flip": 0.0073041170835494995,
      "sparse_tokens": 32105.0,
      "step": 6663,
      "turn_loss": 0.1866278201341629,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.30960787957628694,
      "grad_norm": 0.6006205677986145,
      "learning_rate": 4.206076437383527e-06,
      "loss": 0.1668,
      "mae_dtheta": 0.02826114185154438,
      "mae_dx": 0.006476860027760267,
      "mae_dy": 0.002567038405686617,
      "pose_mae_dtheta": 0.20090901851654053,
      "pose_mae_dx": 0.05738693103194237,
      "pose_mae_dy": 0.028006885200738907,
      "pose_rmse_dtheta": 0.3928309977054596,
      "pose_rmse_dx": 0.13506951928138733,
      "pose_rmse_dy": 0.060935597866773605,
      "pose_rmse_mean": 0.19627872109413147,
      "rmse_dtheta": 0.0460687130689621,
      "rmse_dx": 0.015832751989364624,
      "rmse_dy": 0.005428377538919449,
      "rmse_mean": 0.02244327962398529,
      "rotation_flip": 0.01608187146484852,
      "sparse_tokens": 11276.0,
      "step": 6664,
      "turn_loss": 0.22219863533973694,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3096543393421297,
      "grad_norm": 0.41954922676086426,
      "learning_rate": 4.204771020717564e-06,
      "loss": 0.1374,
      "mae_dtheta": 0.008388794027268887,
      "mae_dx": 0.0025361201260238886,
      "mae_dy": 0.003216505516320467,
      "pose_mae_dtheta": 0.054958272725343704,
      "pose_mae_dx": 0.025553859770298004,
      "pose_mae_dy": 0.025588149204850197,
      "pose_rmse_dtheta": 0.1192920133471489,
      "pose_rmse_dx": 0.07901452481746674,
      "pose_rmse_dy": 0.06398089975118637,
      "pose_rmse_mean": 0.08742915093898773,
      "rmse_dtheta": 0.01945928856730461,
      "rmse_dx": 0.007575087249279022,
      "rmse_dy": 0.008412783034145832,
      "rmse_mean": 0.011815719306468964,
      "rotation_flip": 0.005210421048104763,
      "sparse_tokens": 32105.0,
      "step": 6665,
      "turn_loss": 0.09399454295635223,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3097007991079725,
      "grad_norm": 0.3897550106048584,
      "learning_rate": 4.203465659662388e-06,
      "loss": 0.1002,
      "mae_dtheta": 0.013136547058820724,
      "mae_dx": 0.0028860759921371937,
      "mae_dy": 0.002690537367016077,
      "pose_mae_dtheta": 0.09629879146814346,
      "pose_mae_dx": 0.028681909665465355,
      "pose_mae_dy": 0.028097620233893394,
      "pose_rmse_dtheta": 0.2721850574016571,
      "pose_rmse_dx": 0.07520338147878647,
      "pose_rmse_dy": 0.07454321533441544,
      "pose_rmse_mean": 0.1406438946723938,
      "rmse_dtheta": 0.031155511736869812,
      "rmse_dx": 0.008438507094979286,
      "rmse_dy": 0.007564205676317215,
      "rmse_mean": 0.01571940816938877,
      "rotation_flip": 0.005527210887521505,
      "sparse_tokens": 32153.0,
      "step": 6666,
      "turn_loss": 0.0984102413058281,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.30974725887381527,
      "grad_norm": 0.557072103023529,
      "learning_rate": 4.202160354309286e-06,
      "loss": 0.1862,
      "mae_dtheta": 0.03883318230509758,
      "mae_dx": 0.01414639875292778,
      "mae_dy": 0.005301258992403746,
      "pose_mae_dtheta": 0.3333026170730591,
      "pose_mae_dx": 0.11000890284776688,
      "pose_mae_dy": 0.07246590405702591,
      "pose_rmse_dtheta": 0.5423542261123657,
      "pose_rmse_dx": 0.233803853392601,
      "pose_rmse_dy": 0.18030042946338654,
      "pose_rmse_mean": 0.318819522857666,
      "rmse_dtheta": 0.056576259434223175,
      "rmse_dx": 0.026687150821089745,
      "rmse_dy": 0.011611390858888626,
      "rmse_mean": 0.031624935567379,
      "rotation_flip": 0.014274385757744312,
      "sparse_tokens": 22144.0,
      "step": 6667,
      "turn_loss": 0.3022247552871704,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.30979371863965804,
      "grad_norm": 0.4387678802013397,
      "learning_rate": 4.200855104749541e-06,
      "loss": 0.0761,
      "mae_dtheta": 0.009070008061826229,
      "mae_dx": 0.001694423845037818,
      "mae_dy": 0.00055709108710289,
      "pose_mae_dtheta": 0.06500724703073502,
      "pose_mae_dx": 0.014085203409194946,
      "pose_mae_dy": 0.005144713446497917,
      "pose_rmse_dtheta": 0.25030115246772766,
      "pose_rmse_dx": 0.031584326177835464,
      "pose_rmse_dy": 0.013155868276953697,
      "pose_rmse_mean": 0.09834711998701096,
      "rmse_dtheta": 0.03043685108423233,
      "rmse_dx": 0.004709378816187382,
      "rmse_dy": 0.0016110764117911458,
      "rmse_mean": 0.012252435088157654,
      "rotation_flip": 0.00500625791028142,
      "sparse_tokens": 32201.0,
      "step": 6668,
      "turn_loss": 0.062243908643722534,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.3098401784055008,
      "grad_norm": 0.9475106596946716,
      "learning_rate": 4.199549911074425e-06,
      "loss": 0.3026,
      "mae_dtheta": 0.04833052679896355,
      "mae_dx": 0.012583552859723568,
      "mae_dy": 0.007396383676677942,
      "pose_mae_dtheta": 0.40794771909713745,
      "pose_mae_dx": 0.08588806539773941,
      "pose_mae_dy": 0.07950300723314285,
      "pose_rmse_dtheta": 0.6535463929176331,
      "pose_rmse_dx": 0.1629677265882492,
      "pose_rmse_dy": 0.21276167035102844,
      "pose_rmse_mean": 0.3430919349193573,
      "rmse_dtheta": 0.06756679713726044,
      "rmse_dx": 0.02307969331741333,
      "rmse_dy": 0.01790519431233406,
      "rmse_mean": 0.03618389368057251,
      "rotation_flip": 0.02014652080833912,
      "sparse_tokens": 9374.0,
      "step": 6669,
      "turn_loss": 0.34354981780052185,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.3098866381713436,
      "grad_norm": 0.6680797934532166,
      "learning_rate": 4.1982447733752165e-06,
      "loss": 0.1538,
      "mae_dtheta": 0.02958008088171482,
      "mae_dx": 0.010254747234284878,
      "mae_dy": 0.0069637782871723175,
      "pose_mae_dtheta": 0.23769062757492065,
      "pose_mae_dx": 0.07618818432092667,
      "pose_mae_dy": 0.09155598282814026,
      "pose_rmse_dtheta": 0.38722050189971924,
      "pose_rmse_dx": 0.17391082644462585,
      "pose_rmse_dy": 0.19191846251487732,
      "pose_rmse_mean": 0.25101661682128906,
      "rmse_dtheta": 0.04227627441287041,
      "rmse_dx": 0.022316673770546913,
      "rmse_dy": 0.013462773524224758,
      "rmse_mean": 0.026018574833869934,
      "rotation_flip": 0.013257576152682304,
      "sparse_tokens": 8588.0,
      "step": 6670,
      "turn_loss": 0.2594451904296875,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.3099330979371864,
      "grad_norm": 0.4155380427837372,
      "learning_rate": 4.196939691743178e-06,
      "loss": 0.088,
      "mae_dtheta": 0.02607562206685543,
      "mae_dx": 0.004039110615849495,
      "mae_dy": 0.002745620906352997,
      "pose_mae_dtheta": 0.2215837985277176,
      "pose_mae_dx": 0.030542220920324326,
      "pose_mae_dy": 0.03154947608709335,
      "pose_rmse_dtheta": 0.48109713196754456,
      "pose_rmse_dx": 0.09968354552984238,
      "pose_rmse_dy": 0.06755689531564713,
      "pose_rmse_mean": 0.21611253917217255,
      "rmse_dtheta": 0.04803560674190521,
      "rmse_dx": 0.012265700846910477,
      "rmse_dy": 0.005143445450812578,
      "rmse_mean": 0.021814918145537376,
      "rotation_flip": 0.01515151560306549,
      "sparse_tokens": 7422.0,
      "step": 6671,
      "turn_loss": 0.19484581053256989,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.30997955770302915,
      "grad_norm": 0.4591819941997528,
      "learning_rate": 4.19563466626958e-06,
      "loss": 0.093,
      "mae_dtheta": 0.011160488240420818,
      "mae_dx": 0.0012657485203817487,
      "mae_dy": 0.001939249923452735,
      "pose_mae_dtheta": 0.07866055518388748,
      "pose_mae_dx": 0.0172419436275959,
      "pose_mae_dy": 0.02656988613307476,
      "pose_rmse_dtheta": 0.2311093807220459,
      "pose_rmse_dx": 0.04761625453829765,
      "pose_rmse_dy": 0.06707292050123215,
      "pose_rmse_mean": 0.11526618897914886,
      "rmse_dtheta": 0.026727650314569473,
      "rmse_dx": 0.004228804260492325,
      "rmse_dy": 0.004214971326291561,
      "rmse_mean": 0.011723808944225311,
      "rotation_flip": 0.0051129101775586605,
      "sparse_tokens": 32089.0,
      "step": 6672,
      "turn_loss": 0.06303311139345169,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.310026017468872,
      "grad_norm": 0.3893260955810547,
      "learning_rate": 4.194329697045681e-06,
      "loss": 0.077,
      "mae_dtheta": 0.027278222143650055,
      "mae_dx": 0.008507962338626385,
      "mae_dy": 0.007094489876180887,
      "pose_mae_dtheta": 0.20247496664524078,
      "pose_mae_dx": 0.0696931704878807,
      "pose_mae_dy": 0.08718399703502655,
      "pose_rmse_dtheta": 0.39113280177116394,
      "pose_rmse_dx": 0.18462888896465302,
      "pose_rmse_dy": 0.1715131402015686,
      "pose_rmse_mean": 0.24909161031246185,
      "rmse_dtheta": 0.04561175778508186,
      "rmse_dx": 0.02123255841434002,
      "rmse_dy": 0.012792369350790977,
      "rmse_mean": 0.026545561850070953,
      "rotation_flip": 0.018450183793902397,
      "sparse_tokens": 10243.0,
      "step": 6673,
      "turn_loss": 0.2638985514640808,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 38494.0,
      "epoch": 0.31007247723471476,
      "grad_norm": 0.8867699503898621,
      "learning_rate": 4.193024784162737e-06,
      "loss": 0.2712,
      "mae_dtheta": 0.04442441463470459,
      "mae_dx": 0.011305328458547592,
      "mae_dy": 0.0037665432319045067,
      "pose_mae_dtheta": 0.3571379780769348,
      "pose_mae_dx": 0.09454473108053207,
      "pose_mae_dy": 0.04265101999044418,
      "pose_rmse_dtheta": 0.5787044167518616,
      "pose_rmse_dx": 0.19829131662845612,
      "pose_rmse_dy": 0.11075914651155472,
      "pose_rmse_mean": 0.2959182858467102,
      "rmse_dtheta": 0.062199246138334274,
      "rmse_dx": 0.022499974817037582,
      "rmse_dy": 0.008712568320333958,
      "rmse_mean": 0.031137263402342796,
      "rotation_flip": 0.013078470714390278,
      "sparse_tokens": 26886.0,
      "step": 6674,
      "turn_loss": 0.3012402355670929,
      "turns": 119.0,
      "turns_per_sample": 119.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.31011893700055754,
      "grad_norm": 0.4499252438545227,
      "learning_rate": 4.191719927712005e-06,
      "loss": 0.0804,
      "mae_dtheta": 0.005409132689237595,
      "mae_dx": 0.0011937965173274279,
      "mae_dy": 0.00022116757463663816,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44992536306381226,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.2318572998047,
      "model/head/act_norm_mean": 135.9838719223485,
      "model/head/act_norm_min": 75.19078826904297,
      "model/head/act_over_embed": 93.44938988610485,
      "model/head/grad_frac": 0.08653672784566879,
      "model/head/grad_norm": 0.03893506899476051,
      "model/head/grad_zero_frac": 0.00017227856733370572,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6905283301767676,
      "model/head/update_ratio": 0.0006644054083153605,
      "model/head/weight_delta": 9.254141807556152,
      "model/head/weight_delta_rel": 0.1623450517654419,
      "model/head/weight_norm": 58.60137176513672,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4214992821216583,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42142752789436505,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4213659167289734,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28960894263568565,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09429518133401871,
      "model/modality_embedder.encoders.pose/grad_norm": 0.042425792664289474,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.551063829787234,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013707121834158897,
      "model/modality_embedder.encoders.pose/weight_delta": 2.983996868133545,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09749647974967957,
      "model/modality_embedder.encoders.pose/weight_norm": 30.951642990112305,
      "model/modality_embedder/grad_frac": 0.09429518133401871,
      "model/modality_embedder/grad_norm": 0.042425792664289474,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.551063829787234,
      "model/modality_embedder/update_ratio": 0.0013707121834158897,
      "model/modality_embedder/weight_delta": 2.983996868133545,
      "model/modality_embedder/weight_delta_rel": 0.09749647974967957,
      "model/modality_embedder/weight_norm": 30.951642990112305,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.18988037109375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 26.200932940516275,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.899039268493652,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 18.00552641372169,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0506812259554863,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.022802768275141716,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008176577975973487,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.406017303466797,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08767671883106232,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.887910842895508,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.81163787841797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 27.281710958794292,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.153074264526367,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.748247186285568,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.051854029297828674,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0233304426074028,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007868693792261183,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.051159381866455,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10569454729557037,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.649702072143555,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.5851821899414,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 29.14085297418631,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 11.974143981933594,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 20.02586698482474,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.058299627155065536,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.026230480521917343,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008568360353820026,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.291511058807373,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11052277684211731,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.61318588256836,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.36530303955078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 30.801722582972584,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.930890083312988,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 21.16723212928893,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06376446038484573,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.028689248487353325,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009608897380530834,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8137307167053223,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09615996479988098,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.856962203979492,
      "model/normalizer/grad_frac": 0.21476970613002777,
      "model/normalizer/grad_norm": 0.09663033485412598,
      "model/normalizer/grad_zero_frac": 0.00018671466386877,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001230609486810863,
      "model/normalizer/weight_delta": 5.953558921813965,
      "model/normalizer/weight_delta_rel": 0.07667839527130127,
      "model/normalizer/weight_norm": 78.5223388671875,
      "pose_mae_dtheta": 0.0376286543905735,
      "pose_mae_dx": 0.008385361172258854,
      "pose_mae_dy": 0.0027848670724779367,
      "pose_rmse_dtheta": 0.18990661203861237,
      "pose_rmse_dx": 0.020549070090055466,
      "pose_rmse_dy": 0.004996175412088633,
      "pose_rmse_mean": 0.0718172937631607,
      "rmse_dtheta": 0.02358247898519039,
      "rmse_dx": 0.0035791872069239616,
      "rmse_dy": 0.0004664371663238853,
      "rmse_mean": 0.009209368377923965,
      "rotation_flip": 0.0006211180007085204,
      "sparse_tokens": 32201.0,
      "step": 6675,
      "turn_loss": 0.04124324396252632,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8762.0,
      "epoch": 0.3101653967664003,
      "grad_norm": 0.5488606095314026,
      "learning_rate": 4.190415127784731e-06,
      "loss": 0.1331,
      "mae_dtheta": 0.027953574433922768,
      "mae_dx": 0.007527209352701902,
      "mae_dy": 0.003560541430488229,
      "pose_mae_dtheta": 0.2190137505531311,
      "pose_mae_dx": 0.05470751225948334,
      "pose_mae_dy": 0.028157740831375122,
      "pose_rmse_dtheta": 0.34498289227485657,
      "pose_rmse_dx": 0.11621469259262085,
      "pose_rmse_dy": 0.06976588070392609,
      "pose_rmse_mean": 0.17698782682418823,
      "rmse_dtheta": 0.042037077248096466,
      "rmse_dx": 0.017219265922904015,
      "rmse_dy": 0.00708233006298542,
      "rmse_mean": 0.0221128910779953,
      "rotation_flip": 0.011261261068284512,
      "sparse_tokens": 7627.0,
      "step": 6676,
      "turn_loss": 0.24038152396678925,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3102118565322431,
      "grad_norm": 0.5480340123176575,
      "learning_rate": 4.189110384472164e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.009861050173640251,
      "mae_dx": 0.0018259430071339011,
      "mae_dy": 0.0022591054439544678,
      "pose_mae_dtheta": 0.06607843190431595,
      "pose_mae_dx": 0.022842658683657646,
      "pose_mae_dy": 0.025106018409132957,
      "pose_rmse_dtheta": 0.17944841086864471,
      "pose_rmse_dx": 0.06467457860708237,
      "pose_rmse_dy": 0.07196062803268433,
      "pose_rmse_mean": 0.105361208319664,
      "rmse_dtheta": 0.02345930226147175,
      "rmse_dx": 0.004618094768375158,
      "rmse_dy": 0.005732705816626549,
      "rmse_mean": 0.01127003412693739,
      "rotation_flip": 0.004720692522823811,
      "sparse_tokens": 32185.0,
      "step": 6677,
      "turn_loss": 0.07640453428030014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.31025831629808587,
      "grad_norm": 0.5570999979972839,
      "learning_rate": 4.18780569786554e-06,
      "loss": 0.1559,
      "mae_dtheta": 0.02500380016863346,
      "mae_dx": 0.010890446603298187,
      "mae_dy": 0.006124559324234724,
      "pose_mae_dtheta": 0.18620003759860992,
      "pose_mae_dx": 0.08258798718452454,
      "pose_mae_dy": 0.08821083605289459,
      "pose_rmse_dtheta": 0.30697593092918396,
      "pose_rmse_dx": 0.1835833340883255,
      "pose_rmse_dy": 0.18058155477046967,
      "pose_rmse_mean": 0.22371362149715424,
      "rmse_dtheta": 0.03756435960531235,
      "rmse_dx": 0.023224428296089172,
      "rmse_dy": 0.01092070434242487,
      "rmse_mean": 0.023903165012598038,
      "rotation_flip": 0.007594936527311802,
      "sparse_tokens": 20664.0,
      "step": 6678,
      "turn_loss": 0.24729864299297333,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.31030477606392864,
      "grad_norm": 0.6585636734962463,
      "learning_rate": 4.186501068056102e-06,
      "loss": 0.1297,
      "mae_dtheta": 0.030186183750629425,
      "mae_dx": 0.012365586124360561,
      "mae_dy": 0.005269979126751423,
      "pose_mae_dtheta": 0.23120608925819397,
      "pose_mae_dx": 0.08087316155433655,
      "pose_mae_dy": 0.07653659582138062,
      "pose_rmse_dtheta": 0.41499093174934387,
      "pose_rmse_dx": 0.1926325261592865,
      "pose_rmse_dy": 0.1646575927734375,
      "pose_rmse_mean": 0.25742703676223755,
      "rmse_dtheta": 0.04735715687274933,
      "rmse_dx": 0.026206016540527344,
      "rmse_dy": 0.009825353510677814,
      "rmse_mean": 0.027796177193522453,
      "rotation_flip": 0.014545454643666744,
      "sparse_tokens": 10077.0,
      "step": 6679,
      "turn_loss": 0.22870606184005737,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.3103512358297714,
      "grad_norm": 0.47302761673927307,
      "learning_rate": 4.18519649513508e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.03430686518549919,
      "mae_dx": 0.012165055610239506,
      "mae_dy": 0.007485393900424242,
      "pose_mae_dtheta": 0.26796644926071167,
      "pose_mae_dx": 0.10479368269443512,
      "pose_mae_dy": 0.07177772372961044,
      "pose_rmse_dtheta": 0.4705869257450104,
      "pose_rmse_dx": 0.2510930895805359,
      "pose_rmse_dy": 0.1826096624135971,
      "pose_rmse_mean": 0.3014299273490906,
      "rmse_dtheta": 0.0518326498568058,
      "rmse_dx": 0.023551486432552338,
      "rmse_dy": 0.017688274383544922,
      "rmse_mean": 0.031024139374494553,
      "rotation_flip": 0.014999999664723873,
      "sparse_tokens": 13274.0,
      "step": 6680,
      "turn_loss": 0.3306652009487152,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.3103976955956142,
      "grad_norm": 0.3599088788032532,
      "learning_rate": 4.183891979193703e-06,
      "loss": 0.1037,
      "mae_dtheta": 0.02642204985022545,
      "mae_dx": 0.010434797033667564,
      "mae_dy": 0.00554595747962594,
      "pose_mae_dtheta": 0.2084757685661316,
      "pose_mae_dx": 0.08183908462524414,
      "pose_mae_dy": 0.06509764492511749,
      "pose_rmse_dtheta": 0.35712334513664246,
      "pose_rmse_dx": 0.19885709881782532,
      "pose_rmse_dy": 0.154636412858963,
      "pose_rmse_mean": 0.23687228560447693,
      "rmse_dtheta": 0.04236317798495293,
      "rmse_dx": 0.022787071764469147,
      "rmse_dy": 0.011414233595132828,
      "rmse_mean": 0.025521492585539818,
      "rotation_flip": 0.005366726312786341,
      "sparse_tokens": 10554.0,
      "step": 6681,
      "turn_loss": 0.2858210504055023,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.310444155361457,
      "grad_norm": 0.5161371231079102,
      "learning_rate": 4.1825875203232015e-06,
      "loss": 0.1213,
      "mae_dtheta": 0.0351063497364521,
      "mae_dx": 0.015607422217726707,
      "mae_dy": 0.006494395434856415,
      "pose_mae_dtheta": 0.2866898477077484,
      "pose_mae_dx": 0.1393827199935913,
      "pose_mae_dy": 0.06738200038671494,
      "pose_rmse_dtheta": 0.49783849716186523,
      "pose_rmse_dx": 0.2584531009197235,
      "pose_rmse_dy": 0.14018093049526215,
      "pose_rmse_mean": 0.2988241910934448,
      "rmse_dtheta": 0.054125554859638214,
      "rmse_dx": 0.027379339560866356,
      "rmse_dy": 0.013191280886530876,
      "rmse_mean": 0.03156539425253868,
      "rotation_flip": 0.016233766451478004,
      "sparse_tokens": 6188.0,
      "step": 6682,
      "turn_loss": 0.3317796587944031,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.31049061512729975,
      "grad_norm": 0.3433377742767334,
      "learning_rate": 4.181283118614789e-06,
      "loss": 0.1114,
      "mae_dtheta": 0.01138676330447197,
      "mae_dx": 0.002150076674297452,
      "mae_dy": 0.0036551097873598337,
      "pose_mae_dtheta": 0.07354012131690979,
      "pose_mae_dx": 0.03009158931672573,
      "pose_mae_dy": 0.03268413990736008,
      "pose_rmse_dtheta": 0.18378742039203644,
      "pose_rmse_dx": 0.07985012978315353,
      "pose_rmse_dy": 0.07452734559774399,
      "pose_rmse_mean": 0.11272163689136505,
      "rmse_dtheta": 0.02344202622771263,
      "rmse_dx": 0.005820513237267733,
      "rmse_dy": 0.0070886025205254555,
      "rmse_mean": 0.012117046862840652,
      "rotation_flip": 0.012182741425931454,
      "sparse_tokens": 32089.0,
      "step": 6683,
      "turn_loss": 0.10577191412448883,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.31053707489314253,
      "grad_norm": 0.5369412899017334,
      "learning_rate": 4.179978774159692e-06,
      "loss": 0.0902,
      "mae_dtheta": 0.009095674380660057,
      "mae_dx": 0.0015607788227498531,
      "mae_dy": 0.0023257059510797262,
      "pose_mae_dtheta": 0.06212729960680008,
      "pose_mae_dx": 0.02169705182313919,
      "pose_mae_dy": 0.02244032360613346,
      "pose_rmse_dtheta": 0.17218007147312164,
      "pose_rmse_dx": 0.05231712758541107,
      "pose_rmse_dy": 0.05471361428499222,
      "pose_rmse_mean": 0.09307026863098145,
      "rmse_dtheta": 0.020864058285951614,
      "rmse_dx": 0.004344303160905838,
      "rmse_dy": 0.005194891709834337,
      "rmse_mean": 0.010134417563676834,
      "rotation_flip": 0.005591054446995258,
      "sparse_tokens": 32105.0,
      "step": 6684,
      "turn_loss": 0.07819079607725143,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3105835346589853,
      "grad_norm": 0.47452640533447266,
      "learning_rate": 4.178674487049116e-06,
      "loss": 0.0959,
      "mae_dtheta": 0.009559187106788158,
      "mae_dx": 0.0019509129924699664,
      "mae_dy": 0.0023879441432654858,
      "pose_mae_dtheta": 0.06880462169647217,
      "pose_mae_dx": 0.025393016636371613,
      "pose_mae_dy": 0.03009573556482792,
      "pose_rmse_dtheta": 0.15491174161434174,
      "pose_rmse_dx": 0.067850261926651,
      "pose_rmse_dy": 0.07006075978279114,
      "pose_rmse_mean": 0.09760759770870209,
      "rmse_dtheta": 0.018912117928266525,
      "rmse_dx": 0.006015503779053688,
      "rmse_dy": 0.005315954331308603,
      "rmse_mean": 0.01008119247853756,
      "rotation_flip": 0.0026080477982759476,
      "sparse_tokens": 32105.0,
      "step": 6685,
      "turn_loss": 0.0809580460190773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.3106299944248281,
      "grad_norm": 0.34840404987335205,
      "learning_rate": 4.177370257374273e-06,
      "loss": 0.067,
      "mae_dtheta": 0.010966841131448746,
      "mae_dx": 0.0015758625231683254,
      "mae_dy": 0.0029164855368435383,
      "pose_mae_dtheta": 0.09232389181852341,
      "pose_mae_dx": 0.03866560012102127,
      "pose_mae_dy": 0.06000260263681412,
      "pose_rmse_dtheta": 0.1667691171169281,
      "pose_rmse_dx": 0.09940128028392792,
      "pose_rmse_dy": 0.14828228950500488,
      "pose_rmse_mean": 0.1381509006023407,
      "rmse_dtheta": 0.022888390347361565,
      "rmse_dx": 0.0033016488887369633,
      "rmse_dy": 0.006697164382785559,
      "rmse_mean": 0.010962400585412979,
      "rotation_flip": 0.0,
      "sparse_tokens": 3208.0,
      "step": 6686,
      "turn_loss": 0.09488814324140549,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 38288.0,
      "epoch": 0.31067645419067086,
      "grad_norm": 0.7448979616165161,
      "learning_rate": 4.176066085226373e-06,
      "loss": 0.1822,
      "mae_dtheta": 0.03188714757561684,
      "mae_dx": 0.012908141128718853,
      "mae_dy": 0.003169506788253784,
      "pose_mae_dtheta": 0.2276577651500702,
      "pose_mae_dx": 0.09829821437597275,
      "pose_mae_dy": 0.033395200967788696,
      "pose_rmse_dtheta": 0.4103386700153351,
      "pose_rmse_dx": 0.2238140106201172,
      "pose_rmse_dy": 0.08727706223726273,
      "pose_rmse_mean": 0.2404765784740448,
      "rmse_dtheta": 0.051054369658231735,
      "rmse_dx": 0.02604917250573635,
      "rmse_dy": 0.006480400916188955,
      "rmse_mean": 0.02786131575703621,
      "rotation_flip": 0.013953488320112228,
      "sparse_tokens": 27625.0,
      "step": 6687,
      "turn_loss": 0.2519707679748535,
      "turns": 118.0,
      "turns_per_sample": 118.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.31072291395651364,
      "grad_norm": 0.6635118126869202,
      "learning_rate": 4.174761970696612e-06,
      "loss": 0.1894,
      "mae_dtheta": 0.011208747513592243,
      "mae_dx": 0.0021076411940157413,
      "mae_dy": 0.002669357927516103,
      "pose_mae_dtheta": 0.07368023693561554,
      "pose_mae_dx": 0.020160570740699768,
      "pose_mae_dy": 0.028515243902802467,
      "pose_rmse_dtheta": 0.17565599083900452,
      "pose_rmse_dx": 0.055394407361745834,
      "pose_rmse_dy": 0.07204075902700424,
      "pose_rmse_mean": 0.1010303944349289,
      "rmse_dtheta": 0.02389584295451641,
      "rmse_dx": 0.0066884844563901424,
      "rmse_dy": 0.006177342962473631,
      "rmse_mean": 0.012253890745341778,
      "rotation_flip": 0.00575953908264637,
      "sparse_tokens": 32121.0,
      "step": 6688,
      "turn_loss": 0.09844359010457993,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3107693737223564,
      "grad_norm": 0.3686608374118805,
      "learning_rate": 4.173457913876191e-06,
      "loss": 0.0936,
      "mae_dtheta": 0.01062585785984993,
      "mae_dx": 0.0016520523931831121,
      "mae_dy": 0.0022306707687675953,
      "pose_mae_dtheta": 0.06833402067422867,
      "pose_mae_dx": 0.020246947184205055,
      "pose_mae_dy": 0.026741240173578262,
      "pose_rmse_dtheta": 0.15457358956336975,
      "pose_rmse_dx": 0.04249473288655281,
      "pose_rmse_dy": 0.05899384617805481,
      "pose_rmse_mean": 0.08535405248403549,
      "rmse_dtheta": 0.02193056233227253,
      "rmse_dx": 0.004709399770945311,
      "rmse_dy": 0.004426616244018078,
      "rmse_mean": 0.010355526581406593,
      "rotation_flip": 0.009921313263475895,
      "sparse_tokens": 32121.0,
      "step": 6689,
      "turn_loss": 0.08707642555236816,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.31081583348819924,
      "grad_norm": 0.39698341488838196,
      "learning_rate": 4.172153914856299e-06,
      "loss": 0.0781,
      "mae_dtheta": 0.009012280963361263,
      "mae_dx": 0.00160123105160892,
      "mae_dy": 0.002050260314717889,
      "pose_mae_dtheta": 0.06244206801056862,
      "pose_mae_dx": 0.018013866618275642,
      "pose_mae_dy": 0.028627799823880196,
      "pose_rmse_dtheta": 0.14359943568706512,
      "pose_rmse_dx": 0.04336642846465111,
      "pose_rmse_dy": 0.07025569677352905,
      "pose_rmse_mean": 0.08574052900075912,
      "rmse_dtheta": 0.01812831126153469,
      "rmse_dx": 0.005185682326555252,
      "rmse_dy": 0.0042949640192091465,
      "rmse_mean": 0.009202986024320126,
      "rotation_flip": 0.004838109482079744,
      "sparse_tokens": 32105.0,
      "step": 6690,
      "turn_loss": 0.07417921721935272,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26848.0,
      "epoch": 0.310862293254042,
      "grad_norm": 1.1470942497253418,
      "learning_rate": 4.1708499737281305e-06,
      "loss": 0.3001,
      "mae_dtheta": 0.037503138184547424,
      "mae_dx": 0.018641730770468712,
      "mae_dy": 0.009304998442530632,
      "pose_mae_dtheta": 0.32059815526008606,
      "pose_mae_dx": 0.16328048706054688,
      "pose_mae_dy": 0.111991286277771,
      "pose_rmse_dtheta": 0.5293396711349487,
      "pose_rmse_dx": 0.3121992349624634,
      "pose_rmse_dy": 0.2465796172618866,
      "pose_rmse_mean": 0.36270618438720703,
      "rmse_dtheta": 0.05355352908372879,
      "rmse_dx": 0.031829919666051865,
      "rmse_dy": 0.01828140765428543,
      "rmse_mean": 0.03455495089292526,
      "rotation_flip": 0.011589404195547104,
      "sparse_tokens": 22160.0,
      "step": 6691,
      "turn_loss": 0.39389464259147644,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3109087530198848,
      "grad_norm": 0.9691596031188965,
      "learning_rate": 4.169546090582867e-06,
      "loss": 0.1922,
      "mae_dtheta": 0.01654592715203762,
      "mae_dx": 0.0037695111241191626,
      "mae_dy": 0.006035645492374897,
      "pose_mae_dtheta": 0.11877534538507462,
      "pose_mae_dx": 0.04843619093298912,
      "pose_mae_dy": 0.05847502872347832,
      "pose_rmse_dtheta": 0.27845796942710876,
      "pose_rmse_dx": 0.12645429372787476,
      "pose_rmse_dy": 0.15323886275291443,
      "pose_rmse_mean": 0.1860503852367401,
      "rmse_dtheta": 0.03378122299909592,
      "rmse_dx": 0.010018718428909779,
      "rmse_dy": 0.013482427224516869,
      "rmse_mean": 0.01909412257373333,
      "rotation_flip": 0.0110941082239151,
      "sparse_tokens": 32057.0,
      "step": 6692,
      "turn_loss": 0.16586542129516602,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3109552127857276,
      "grad_norm": 0.5791013836860657,
      "learning_rate": 4.16824226551169e-06,
      "loss": 0.1053,
      "mae_dtheta": 0.010256223380565643,
      "mae_dx": 0.002325903857126832,
      "mae_dy": 0.0021246906835585833,
      "pose_mae_dtheta": 0.06680741906166077,
      "pose_mae_dx": 0.029533343389630318,
      "pose_mae_dy": 0.025789158418774605,
      "pose_rmse_dtheta": 0.1929357498884201,
      "pose_rmse_dx": 0.09632864594459534,
      "pose_rmse_dy": 0.0827781930565834,
      "pose_rmse_mean": 0.12401419132947922,
      "rmse_dtheta": 0.026675716042518616,
      "rmse_dx": 0.008102765306830406,
      "rmse_dy": 0.006039868574589491,
      "rmse_mean": 0.0136061180382967,
      "rotation_flip": 0.004273504484444857,
      "sparse_tokens": 32057.0,
      "step": 6693,
      "turn_loss": 0.08837516605854034,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.31100167255157035,
      "grad_norm": 0.5358344316482544,
      "learning_rate": 4.1669384986057806e-06,
      "loss": 0.1494,
      "mae_dtheta": 0.02859279327094555,
      "mae_dx": 0.012146469205617905,
      "mae_dy": 0.004115930758416653,
      "pose_mae_dtheta": 0.2381085455417633,
      "pose_mae_dx": 0.10472581535577774,
      "pose_mae_dy": 0.03321044519543648,
      "pose_rmse_dtheta": 0.3934857249259949,
      "pose_rmse_dx": 0.21637952327728271,
      "pose_rmse_dy": 0.06945669651031494,
      "pose_rmse_mean": 0.2264406532049179,
      "rmse_dtheta": 0.044018808752298355,
      "rmse_dx": 0.02296605333685875,
      "rmse_dy": 0.008828367106616497,
      "rmse_mean": 0.02527107670903206,
      "rotation_flip": 0.01440329197794199,
      "sparse_tokens": 9411.0,
      "step": 6694,
      "turn_loss": 0.2261780947446823,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 15220.0,
      "epoch": 0.31104813231741313,
      "grad_norm": 0.5792732834815979,
      "learning_rate": 4.165634789956306e-06,
      "loss": 0.1191,
      "mae_dtheta": 0.03335265442728996,
      "mae_dx": 0.013331382535398006,
      "mae_dy": 0.004576100502163172,
      "pose_mae_dtheta": 0.2513887286186218,
      "pose_mae_dx": 0.1267896443605423,
      "pose_mae_dy": 0.0623963437974453,
      "pose_rmse_dtheta": 0.4226096570491791,
      "pose_rmse_dx": 0.2895423173904419,
      "pose_rmse_dy": 0.13073663413524628,
      "pose_rmse_mean": 0.28096288442611694,
      "rmse_dtheta": 0.05085720494389534,
      "rmse_dx": 0.027447471395134926,
      "rmse_dy": 0.008288687095046043,
      "rmse_mean": 0.028864456340670586,
      "rotation_flip": 0.016845328733325005,
      "sparse_tokens": 13134.0,
      "step": 6695,
      "turn_loss": 0.2486611008644104,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3110945920832559,
      "grad_norm": 0.38026008009910583,
      "learning_rate": 4.164331139654442e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.009161882102489471,
      "mae_dx": 0.0013149569276720285,
      "mae_dy": 0.0022860055323690176,
      "pose_mae_dtheta": 0.061260830610990524,
      "pose_mae_dx": 0.02188998833298683,
      "pose_mae_dy": 0.031136352568864822,
      "pose_rmse_dtheta": 0.14950346946716309,
      "pose_rmse_dx": 0.06278903037309647,
      "pose_rmse_dy": 0.07719004154205322,
      "pose_rmse_mean": 0.09649418294429779,
      "rmse_dtheta": 0.019147060811519623,
      "rmse_dx": 0.0049164555966854095,
      "rmse_dy": 0.004983801860362291,
      "rmse_mean": 0.009682439267635345,
      "rotation_flip": 0.0027910685166716576,
      "sparse_tokens": 32057.0,
      "step": 6696,
      "turn_loss": 0.07844468206167221,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.3111410518490987,
      "grad_norm": 0.5171747803688049,
      "learning_rate": 4.163027547791347e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.025208784267306328,
      "mae_dx": 0.012369947507977486,
      "mae_dy": 0.00460784463211894,
      "pose_mae_dtheta": 0.18533292412757874,
      "pose_mae_dx": 0.10074096918106079,
      "pose_mae_dy": 0.07978365570306778,
      "pose_rmse_dtheta": 0.3147324323654175,
      "pose_rmse_dx": 0.22519871592521667,
      "pose_rmse_dy": 0.18549658358097076,
      "pose_rmse_mean": 0.24180924892425537,
      "rmse_dtheta": 0.04030986875295639,
      "rmse_dx": 0.026221023872494698,
      "rmse_dy": 0.008616365492343903,
      "rmse_mean": 0.025049086660146713,
      "rotation_flip": 0.006006006151437759,
      "sparse_tokens": 13340.0,
      "step": 6697,
      "turn_loss": 0.2240571528673172,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 32986.0,
      "epoch": 0.31118751161494146,
      "grad_norm": 0.532096803188324,
      "learning_rate": 4.161724014458187e-06,
      "loss": 0.1497,
      "mae_dtheta": 0.03492475301027298,
      "mae_dx": 0.010644177906215191,
      "mae_dy": 0.005027546547353268,
      "pose_mae_dtheta": 0.28923851251602173,
      "pose_mae_dx": 0.07849863916635513,
      "pose_mae_dy": 0.05516018718481064,
      "pose_rmse_dtheta": 0.4932080805301666,
      "pose_rmse_dx": 0.17101073265075684,
      "pose_rmse_dy": 0.1466437131166458,
      "pose_rmse_mean": 0.27028751373291016,
      "rmse_dtheta": 0.053337085992097855,
      "rmse_dx": 0.021843411028385162,
      "rmse_dy": 0.01072497945278883,
      "rmse_mean": 0.028635159134864807,
      "rotation_flip": 0.014294996857643127,
      "sparse_tokens": 26686.0,
      "step": 6698,
      "turn_loss": 0.2625279128551483,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.31123397138078424,
      "grad_norm": 0.44803309440612793,
      "learning_rate": 4.160420539746115e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.010691074654459953,
      "mae_dx": 0.001984747825190425,
      "mae_dy": 0.001927628181874752,
      "pose_mae_dtheta": 0.07520163804292679,
      "pose_mae_dx": 0.02188130095601082,
      "pose_mae_dy": 0.023953542113304138,
      "pose_rmse_dtheta": 0.23299305140972137,
      "pose_rmse_dx": 0.08026151359081268,
      "pose_rmse_dy": 0.09804093092679977,
      "pose_rmse_mean": 0.1370985060930252,
      "rmse_dtheta": 0.029464883729815483,
      "rmse_dx": 0.005763477645814419,
      "rmse_dy": 0.007326274644583464,
      "rmse_mean": 0.014184879139065742,
      "rotation_flip": 0.0033917466644197702,
      "sparse_tokens": 32137.0,
      "step": 6699,
      "turn_loss": 0.0912787914276123,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.311280431146627,
      "grad_norm": 0.4274734556674957,
      "learning_rate": 4.159117123746286e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.005308380350470543,
      "mae_dx": 0.001212475006468594,
      "mae_dy": 0.0008998232078738511,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4274733066558838,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.95892333984375,
      "model/head/act_norm_mean": 123.74363754734848,
      "model/head/act_norm_min": 88.30089569091797,
      "model/head/act_over_embed": 85.03778622872515,
      "model/head/grad_frac": 0.1214902326464653,
      "model/head/grad_norm": 0.051933832466602325,
      "model/head/grad_zero_frac": 0.00017862400272861123,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6986910116792929,
      "model/head/update_ratio": 0.0008861908572725952,
      "model/head/weight_delta": 9.265541076660156,
      "model/head/weight_delta_rel": 0.16254504024982452,
      "model/head/weight_norm": 58.60343933105469,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.421416699886322,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4213511809642181,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4212876558303833,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28955647631051745,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0730150043964386,
      "model/modality_embedder.encoders.pose/grad_norm": 0.031211964786052704,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5509334415584416,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010083996457979083,
      "model/modality_embedder.encoders.pose/weight_delta": 2.984982490539551,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09752868115901947,
      "model/modality_embedder.encoders.pose/weight_norm": 30.95197868347168,
      "model/modality_embedder/grad_frac": 0.0730150043964386,
      "model/modality_embedder/grad_norm": 0.031211964786052704,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5509334415584416,
      "model/modality_embedder/update_ratio": 0.0010083996457979083,
      "model/modality_embedder/weight_delta": 2.984982490539551,
      "model/modality_embedder/weight_delta_rel": 0.09752868115901947,
      "model/modality_embedder/weight_norm": 30.95197868347168,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.5877456665039,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.97865810886644,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.972423553466797,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.16556770629466,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0844886302947998,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03611663356423378,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012950140517205,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4107251167297363,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08784827589988708,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.888988494873047,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.65682983398438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.009667608625943,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.318233489990234,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.874087086992404,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09458866715431213,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.040434129536151886,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001363641582429409,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.0569894313812256,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10589650273323059,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.651580810546875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.33453369140625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.85281886323553,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.577768325805664,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.14071788501403,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.10537166148424149,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.045043572783470154,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014713079435750842,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.297633171081543,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11072834581136703,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.614646911621094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.86003112792969,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.54596310325477,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.010782241821289,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.30426245822137,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11694101244211197,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.049989160150289536,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016742011066526175,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8195879459381104,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09636013209819794,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.858516693115234,
      "model/normalizer/grad_frac": 0.40360528230667114,
      "model/normalizer/grad_norm": 0.17253048717975616,
      "model/normalizer/grad_zero_frac": 0.0001571712055010721,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002197165274992585,
      "model/normalizer/weight_delta": 5.965047836303711,
      "model/normalizer/weight_delta_rel": 0.07682636380195618,
      "model/normalizer/weight_norm": 78.52412414550781,
      "pose_mae_dtheta": 0.03527645766735077,
      "pose_mae_dx": 0.010845787823200226,
      "pose_mae_dy": 0.011906770057976246,
      "pose_rmse_dtheta": 0.10480976104736328,
      "pose_rmse_dx": 0.02976730652153492,
      "pose_rmse_dy": 0.03853362798690796,
      "pose_rmse_mean": 0.057703565806150436,
      "rmse_dtheta": 0.016225075349211693,
      "rmse_dx": 0.003436541883274913,
      "rmse_dy": 0.0035003747325390577,
      "rmse_mean": 0.00772066367790103,
      "rotation_flip": 0.0005136106628924608,
      "sparse_tokens": 32169.0,
      "step": 6700,
      "turn_loss": 0.03991314768791199,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3113268909124698,
      "grad_norm": 0.547175943851471,
      "learning_rate": 4.1578137665498485e-06,
      "loss": 0.1195,
      "mae_dtheta": 0.007569984532892704,
      "mae_dx": 0.001415276899933815,
      "mae_dy": 0.0021573363337665796,
      "pose_mae_dtheta": 0.05089281126856804,
      "pose_mae_dx": 0.022458117455244064,
      "pose_mae_dy": 0.025349585339426994,
      "pose_rmse_dtheta": 0.09560345858335495,
      "pose_rmse_dx": 0.05865195766091347,
      "pose_rmse_dy": 0.05706116184592247,
      "pose_rmse_mean": 0.07043886184692383,
      "rmse_dtheta": 0.01509803906083107,
      "rmse_dx": 0.003639331553131342,
      "rmse_dy": 0.004671999253332615,
      "rmse_mean": 0.007803123444318771,
      "rotation_flip": 0.001939487992785871,
      "sparse_tokens": 32121.0,
      "step": 6701,
      "turn_loss": 0.0699201226234436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.31137335067831257,
      "grad_norm": 0.33755025267601013,
      "learning_rate": 4.1565104682479445e-06,
      "loss": 0.0863,
      "mae_dtheta": 0.014289526268839836,
      "mae_dx": 0.0020606867037713528,
      "mae_dy": 0.004662603139877319,
      "pose_mae_dtheta": 0.09093154966831207,
      "pose_mae_dx": 0.03668723627924919,
      "pose_mae_dy": 0.04827991500496864,
      "pose_rmse_dtheta": 0.1781388819217682,
      "pose_rmse_dx": 0.09045592695474625,
      "pose_rmse_dy": 0.11467800289392471,
      "pose_rmse_mean": 0.12775760889053345,
      "rmse_dtheta": 0.024760814383625984,
      "rmse_dx": 0.0046540857292711735,
      "rmse_dy": 0.008990366011857986,
      "rmse_mean": 0.012801755219697952,
      "rotation_flip": 0.0038736590649932623,
      "sparse_tokens": 32089.0,
      "step": 6702,
      "turn_loss": 0.11713093519210815,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.31141981044415534,
      "grad_norm": 0.6838610768318176,
      "learning_rate": 4.1552072289317185e-06,
      "loss": 0.133,
      "mae_dtheta": 0.03445197641849518,
      "mae_dx": 0.006308798212558031,
      "mae_dy": 0.0034645074047148228,
      "pose_mae_dtheta": 0.28042179346084595,
      "pose_mae_dx": 0.04081137105822563,
      "pose_mae_dy": 0.028702829033136368,
      "pose_rmse_dtheta": 0.5773170590400696,
      "pose_rmse_dx": 0.09007538855075836,
      "pose_rmse_dy": 0.058066412806510925,
      "pose_rmse_mean": 0.2418196201324463,
      "rmse_dtheta": 0.056917041540145874,
      "rmse_dx": 0.014225706458091736,
      "rmse_dy": 0.007157450541853905,
      "rmse_mean": 0.026100067421793938,
      "rotation_flip": 0.007054673507809639,
      "sparse_tokens": 9310.0,
      "step": 6703,
      "turn_loss": 0.24630507826805115,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.3114662702099981,
      "grad_norm": 0.6063316464424133,
      "learning_rate": 4.1539040486923025e-06,
      "loss": 0.1226,
      "mae_dtheta": 0.0392710417509079,
      "mae_dx": 0.012529836967587471,
      "mae_dy": 0.004780939780175686,
      "pose_mae_dtheta": 0.32143014669418335,
      "pose_mae_dx": 0.10123857110738754,
      "pose_mae_dy": 0.06744660437107086,
      "pose_rmse_dtheta": 0.555159866809845,
      "pose_rmse_dx": 0.20849278569221497,
      "pose_rmse_dy": 0.157695010304451,
      "pose_rmse_mean": 0.30711591243743896,
      "rmse_dtheta": 0.057517558336257935,
      "rmse_dx": 0.02514803037047386,
      "rmse_dy": 0.008544014766812325,
      "rmse_mean": 0.030403202399611473,
      "rotation_flip": 0.013761468231678009,
      "sparse_tokens": 24651.0,
      "step": 6704,
      "turn_loss": 0.2907710671424866,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.3115127299758409,
      "grad_norm": 0.49495962262153625,
      "learning_rate": 4.15260092762083e-06,
      "loss": 0.0824,
      "mae_dtheta": 0.0390893928706646,
      "mae_dx": 0.01044647116214037,
      "mae_dy": 0.005496127065271139,
      "pose_mae_dtheta": 0.27889421582221985,
      "pose_mae_dx": 0.06626766175031662,
      "pose_mae_dy": 0.05957300215959549,
      "pose_rmse_dtheta": 0.4997425377368927,
      "pose_rmse_dx": 0.12130573391914368,
      "pose_rmse_dy": 0.1251334398984909,
      "pose_rmse_mean": 0.2487272471189499,
      "rmse_dtheta": 0.057975441217422485,
      "rmse_dx": 0.021208787336945534,
      "rmse_dy": 0.009941044263541698,
      "rmse_mean": 0.02970842272043228,
      "rotation_flip": 0.016447369009256363,
      "sparse_tokens": 4935.0,
      "step": 6705,
      "turn_loss": 0.2353370189666748,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.31155918974168373,
      "grad_norm": 0.5159821510314941,
      "learning_rate": 4.151297865808432e-06,
      "loss": 0.1342,
      "mae_dtheta": 0.01134186889976263,
      "mae_dx": 0.0018208237597718835,
      "mae_dy": 0.0028836634010076523,
      "pose_mae_dtheta": 0.0735943391919136,
      "pose_mae_dx": 0.02812841907143593,
      "pose_mae_dy": 0.036484673619270325,
      "pose_rmse_dtheta": 0.13895826041698456,
      "pose_rmse_dx": 0.07239916920661926,
      "pose_rmse_dy": 0.08050791174173355,
      "pose_rmse_mean": 0.09728845208883286,
      "rmse_dtheta": 0.02120494842529297,
      "rmse_dx": 0.005638255272060633,
      "rmse_dy": 0.006148290820419788,
      "rmse_mean": 0.010997164994478226,
      "rotation_flip": 0.0014331780839711428,
      "sparse_tokens": 32073.0,
      "step": 6706,
      "turn_loss": 0.0971415713429451,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.3116056495075265,
      "grad_norm": 0.7251625657081604,
      "learning_rate": 4.149994863346227e-06,
      "loss": 0.239,
      "mae_dtheta": 0.02122085727751255,
      "mae_dx": 0.0072890035808086395,
      "mae_dy": 0.0041689686477184296,
      "pose_mae_dtheta": 0.17426271736621857,
      "pose_mae_dx": 0.055528365075588226,
      "pose_mae_dy": 0.054236482828855515,
      "pose_rmse_dtheta": 0.3254353404045105,
      "pose_rmse_dx": 0.1419990062713623,
      "pose_rmse_dy": 0.1363622099161148,
      "pose_rmse_mean": 0.20126551389694214,
      "rmse_dtheta": 0.03674084693193436,
      "rmse_dx": 0.018594760447740555,
      "rmse_dy": 0.009044378064572811,
      "rmse_mean": 0.021459994837641716,
      "rotation_flip": 0.010810811072587967,
      "sparse_tokens": 11514.0,
      "step": 6707,
      "turn_loss": 0.19528116285800934,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3116521092733693,
      "grad_norm": 0.31716519594192505,
      "learning_rate": 4.1486919203253395e-06,
      "loss": 0.092,
      "mae_dtheta": 0.011197633109986782,
      "mae_dx": 0.002008529845625162,
      "mae_dy": 0.002629439113661647,
      "pose_mae_dtheta": 0.07754097133874893,
      "pose_mae_dx": 0.024988560006022453,
      "pose_mae_dy": 0.026953261345624924,
      "pose_rmse_dtheta": 0.20738966763019562,
      "pose_rmse_dx": 0.07456223666667938,
      "pose_rmse_dy": 0.06669679284095764,
      "pose_rmse_mean": 0.11621623486280441,
      "rmse_dtheta": 0.024465639144182205,
      "rmse_dx": 0.006074410863220692,
      "rmse_dy": 0.006585134658962488,
      "rmse_mean": 0.012375062331557274,
      "rotation_flip": 0.007957560010254383,
      "sparse_tokens": 32137.0,
      "step": 6708,
      "turn_loss": 0.09025578200817108,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.31169856903921206,
      "grad_norm": 0.5542660355567932,
      "learning_rate": 4.147389036836881e-06,
      "loss": 0.1723,
      "mae_dtheta": 0.040882136672735214,
      "mae_dx": 0.00960912462323904,
      "mae_dy": 0.005767973605543375,
      "pose_mae_dtheta": 0.3334462642669678,
      "pose_mae_dx": 0.08744703233242035,
      "pose_mae_dy": 0.06975351274013519,
      "pose_rmse_dtheta": 0.5493861436843872,
      "pose_rmse_dx": 0.1990654617547989,
      "pose_rmse_dy": 0.18065252900123596,
      "pose_rmse_mean": 0.3097013831138611,
      "rmse_dtheta": 0.05996103957295418,
      "rmse_dx": 0.02144494093954563,
      "rmse_dy": 0.012246346101164818,
      "rmse_mean": 0.03121744468808174,
      "rotation_flip": 0.022651007398962975,
      "sparse_tokens": 17806.0,
      "step": 6709,
      "turn_loss": 0.2913932204246521,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.31174502880505484,
      "grad_norm": 0.7858747839927673,
      "learning_rate": 4.146086212971967e-06,
      "loss": 0.1951,
      "mae_dtheta": 0.018135495483875275,
      "mae_dx": 0.00448148837313056,
      "mae_dy": 0.006202858407050371,
      "pose_mae_dtheta": 0.1078106164932251,
      "pose_mae_dx": 0.04724613204598427,
      "pose_mae_dy": 0.04888627678155899,
      "pose_rmse_dtheta": 0.16185134649276733,
      "pose_rmse_dx": 0.11170651018619537,
      "pose_rmse_dy": 0.10578612238168716,
      "pose_rmse_mean": 0.12644799053668976,
      "rmse_dtheta": 0.02852395921945572,
      "rmse_dx": 0.010634672828018665,
      "rmse_dy": 0.011724546551704407,
      "rmse_mean": 0.01696106046438217,
      "rotation_flip": 0.010791366919875145,
      "sparse_tokens": 4462.0,
      "step": 6710,
      "turn_loss": 0.19623444974422455,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3117914885708976,
      "grad_norm": 0.5977920889854431,
      "learning_rate": 4.1447834488217005e-06,
      "loss": 0.1195,
      "mae_dtheta": 0.008177613839507103,
      "mae_dx": 0.001956457970663905,
      "mae_dy": 0.0014417979400604963,
      "pose_mae_dtheta": 0.056533005088567734,
      "pose_mae_dx": 0.017556652426719666,
      "pose_mae_dy": 0.013265346176922321,
      "pose_rmse_dtheta": 0.21425418555736542,
      "pose_rmse_dx": 0.05615762248635292,
      "pose_rmse_dy": 0.03364873677492142,
      "pose_rmse_mean": 0.10135351866483688,
      "rmse_dtheta": 0.02482885867357254,
      "rmse_dx": 0.006289178039878607,
      "rmse_dy": 0.005323699675500393,
      "rmse_mean": 0.012147245928645134,
      "rotation_flip": 0.0054298643954098225,
      "sparse_tokens": 32169.0,
      "step": 6711,
      "turn_loss": 0.08764921128749847,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3118379483367404,
      "grad_norm": 0.46340668201446533,
      "learning_rate": 4.143480744477187e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.010413136333227158,
      "mae_dx": 0.001452611992135644,
      "mae_dy": 0.0018841917626559734,
      "pose_mae_dtheta": 0.07425081729888916,
      "pose_mae_dx": 0.019027914851903915,
      "pose_mae_dy": 0.025712037459015846,
      "pose_rmse_dtheta": 0.2240099310874939,
      "pose_rmse_dx": 0.049837950617074966,
      "pose_rmse_dy": 0.06115923449397087,
      "pose_rmse_mean": 0.11166903376579285,
      "rmse_dtheta": 0.024759387597441673,
      "rmse_dx": 0.004660720005631447,
      "rmse_dy": 0.0038582992274314165,
      "rmse_mean": 0.01109280250966549,
      "rotation_flip": 0.00458906963467598,
      "sparse_tokens": 32089.0,
      "step": 6712,
      "turn_loss": 0.07760126888751984,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.31188440810258317,
      "grad_norm": 0.33218851685523987,
      "learning_rate": 4.1421781000295255e-06,
      "loss": 0.0825,
      "mae_dtheta": 0.01094136107712984,
      "mae_dx": 0.001870583975687623,
      "mae_dy": 0.0008204140467569232,
      "pose_mae_dtheta": 0.07512634992599487,
      "pose_mae_dx": 0.015012294985353947,
      "pose_mae_dy": 0.009085891768336296,
      "pose_rmse_dtheta": 0.26778939366340637,
      "pose_rmse_dx": 0.04029421508312225,
      "pose_rmse_dy": 0.02881791442632675,
      "pose_rmse_mean": 0.11230050772428513,
      "rmse_dtheta": 0.031212151050567627,
      "rmse_dx": 0.006118793040513992,
      "rmse_dy": 0.0023095302749425173,
      "rmse_mean": 0.01321349199861288,
      "rotation_flip": 0.0019950123969465494,
      "sparse_tokens": 32201.0,
      "step": 6713,
      "turn_loss": 0.06811179220676422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.31193086786842594,
      "grad_norm": 0.5652775168418884,
      "learning_rate": 4.140875515569809e-06,
      "loss": 0.1147,
      "mae_dtheta": 0.010436578653752804,
      "mae_dx": 0.002026135101914406,
      "mae_dy": 0.002407380612567067,
      "pose_mae_dtheta": 0.07566340267658234,
      "pose_mae_dx": 0.021574484184384346,
      "pose_mae_dy": 0.026912450790405273,
      "pose_rmse_dtheta": 0.23157939314842224,
      "pose_rmse_dx": 0.06385134905576706,
      "pose_rmse_dy": 0.06377167254686356,
      "pose_rmse_mean": 0.11973413825035095,
      "rmse_dtheta": 0.0257550235837698,
      "rmse_dx": 0.006598999723792076,
      "rmse_dy": 0.007285814732313156,
      "rmse_mean": 0.013213279657065868,
      "rotation_flip": 0.004244031850248575,
      "sparse_tokens": 32041.0,
      "step": 6714,
      "turn_loss": 0.0825590267777443,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.3119773276342687,
      "grad_norm": 0.41317519545555115,
      "learning_rate": 4.139572991189131e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.03343426063656807,
      "mae_dx": 0.004435843788087368,
      "mae_dy": 0.002286462811753154,
      "pose_mae_dtheta": 0.2601192593574524,
      "pose_mae_dx": 0.026350412517786026,
      "pose_mae_dy": 0.013714537024497986,
      "pose_rmse_dtheta": 0.4938899874687195,
      "pose_rmse_dx": 0.07118553668260574,
      "pose_rmse_dy": 0.028605405241250992,
      "pose_rmse_mean": 0.1978936493396759,
      "rmse_dtheta": 0.05539604276418686,
      "rmse_dx": 0.011908491142094135,
      "rmse_dy": 0.005705396644771099,
      "rmse_mean": 0.024336643517017365,
      "rotation_flip": 0.007246376946568489,
      "sparse_tokens": 4389.0,
      "step": 6715,
      "turn_loss": 0.21424582600593567,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3120237874001115,
      "grad_norm": 0.46008047461509705,
      "learning_rate": 4.138270526978573e-06,
      "loss": 0.1156,
      "mae_dtheta": 0.009666038677096367,
      "mae_dx": 0.0017796119209378958,
      "mae_dy": 0.002214101841673255,
      "pose_mae_dtheta": 0.061420589685440063,
      "pose_mae_dx": 0.01591789536178112,
      "pose_mae_dy": 0.02278658002614975,
      "pose_rmse_dtheta": 0.13415801525115967,
      "pose_rmse_dx": 0.035971298813819885,
      "pose_rmse_dy": 0.06528552621603012,
      "pose_rmse_mean": 0.07847161591053009,
      "rmse_dtheta": 0.02090957760810852,
      "rmse_dx": 0.005117933731526136,
      "rmse_dy": 0.00649213558062911,
      "rmse_mean": 0.010839882306754589,
      "rotation_flip": 0.003916960209608078,
      "sparse_tokens": 32153.0,
      "step": 6716,
      "turn_loss": 0.08247517794370651,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 62262.0,
      "epoch": 0.3120702471659543,
      "grad_norm": 0.5009764432907104,
      "learning_rate": 4.136968123029221e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.008724718354642391,
      "mae_dx": 0.001145051559433341,
      "mae_dy": 0.001503290026448667,
      "pose_mae_dtheta": 0.05510637164115906,
      "pose_mae_dx": 0.014648518525063992,
      "pose_mae_dy": 0.01621481403708458,
      "pose_rmse_dtheta": 0.19651992619037628,
      "pose_rmse_dx": 0.034904614090919495,
      "pose_rmse_dy": 0.03779648244380951,
      "pose_rmse_mean": 0.0897403359413147,
      "rmse_dtheta": 0.02299354039132595,
      "rmse_dx": 0.003516977187246084,
      "rmse_dy": 0.003159299260005355,
      "rmse_mean": 0.009889939799904823,
      "rotation_flip": 0.004365079570561647,
      "sparse_tokens": 31962.0,
      "step": 6717,
      "turn_loss": 0.06361723691225052,
      "turns": 191.0,
      "turns_per_sample": 191.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.31211670693179705,
      "grad_norm": 0.45665276050567627,
      "learning_rate": 4.13566577943215e-06,
      "loss": 0.124,
      "mae_dtheta": 0.009625663049519062,
      "mae_dx": 0.0020779846236109734,
      "mae_dy": 0.0027912401128560305,
      "pose_mae_dtheta": 0.06576178967952728,
      "pose_mae_dx": 0.023390216752886772,
      "pose_mae_dy": 0.032356034964323044,
      "pose_rmse_dtheta": 0.12844978272914886,
      "pose_rmse_dx": 0.0607534758746624,
      "pose_rmse_dy": 0.07157935947179794,
      "pose_rmse_mean": 0.08692754805088043,
      "rmse_dtheta": 0.018356217071413994,
      "rmse_dx": 0.006025909911841154,
      "rmse_dy": 0.0068686408922076225,
      "rmse_mean": 0.010416923090815544,
      "rotation_flip": 0.0033783784601837397,
      "sparse_tokens": 32153.0,
      "step": 6718,
      "turn_loss": 0.09046123176813126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.3121631666976398,
      "grad_norm": 0.5166395902633667,
      "learning_rate": 4.134363496278436e-06,
      "loss": 0.2007,
      "mae_dtheta": 0.02670195698738098,
      "mae_dx": 0.009698410518467426,
      "mae_dy": 0.004304450936615467,
      "pose_mae_dtheta": 0.21420899033546448,
      "pose_mae_dx": 0.08282835781574249,
      "pose_mae_dy": 0.06889795511960983,
      "pose_rmse_dtheta": 0.39912086725234985,
      "pose_rmse_dx": 0.2086741030216217,
      "pose_rmse_dy": 0.1862105280160904,
      "pose_rmse_mean": 0.2646685242652893,
      "rmse_dtheta": 0.04413261637091637,
      "rmse_dx": 0.022419212386012077,
      "rmse_dy": 0.008962667547166348,
      "rmse_mean": 0.025171499699354172,
      "rotation_flip": 0.010338345542550087,
      "sparse_tokens": 20668.0,
      "step": 6719,
      "turn_loss": 0.20920167863368988,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.3122096264634826,
      "grad_norm": 0.5591261982917786,
      "learning_rate": 4.133061273659148e-06,
      "loss": 0.1416,
      "mae_dtheta": 0.029765335842967033,
      "mae_dx": 0.008912566117942333,
      "mae_dy": 0.008291667327284813,
      "pose_mae_dtheta": 0.23657062649726868,
      "pose_mae_dx": 0.06805229187011719,
      "pose_mae_dy": 0.09087801724672318,
      "pose_rmse_dtheta": 0.4351184070110321,
      "pose_rmse_dx": 0.16935676336288452,
      "pose_rmse_dy": 0.22718067467212677,
      "pose_rmse_mean": 0.27721861004829407,
      "rmse_dtheta": 0.04921618103981018,
      "rmse_dx": 0.020145123824477196,
      "rmse_dy": 0.017549142241477966,
      "rmse_mean": 0.028970150277018547,
      "rotation_flip": 0.010204081423580647,
      "sparse_tokens": 19465.0,
      "step": 6720,
      "turn_loss": 0.2898097634315491,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3122560862293254,
      "grad_norm": 0.47396644949913025,
      "learning_rate": 4.131759111665349e-06,
      "loss": 0.1015,
      "mae_dtheta": 0.00909449253231287,
      "mae_dx": 0.0012324483832344413,
      "mae_dy": 0.0018456163816154003,
      "pose_mae_dtheta": 0.05674349516630173,
      "pose_mae_dx": 0.015476458705961704,
      "pose_mae_dy": 0.024642882868647575,
      "pose_rmse_dtheta": 0.13293743133544922,
      "pose_rmse_dx": 0.037469811737537384,
      "pose_rmse_dy": 0.06293287873268127,
      "pose_rmse_mean": 0.07778003811836243,
      "rmse_dtheta": 0.019503837451338768,
      "rmse_dx": 0.0037513631395995617,
      "rmse_dy": 0.004025397356599569,
      "rmse_mean": 0.009093533270061016,
      "rotation_flip": 0.006797281093895435,
      "sparse_tokens": 32089.0,
      "step": 6721,
      "turn_loss": 0.06969643384218216,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.31230254599516816,
      "grad_norm": 0.5834061503410339,
      "learning_rate": 4.130457010388103e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.012205330654978752,
      "mae_dx": 0.0017782171489670873,
      "mae_dy": 0.003549164393916726,
      "pose_mae_dtheta": 0.08481092751026154,
      "pose_mae_dx": 0.02868901751935482,
      "pose_mae_dy": 0.04116230085492134,
      "pose_rmse_dtheta": 0.18031339347362518,
      "pose_rmse_dx": 0.07992246001958847,
      "pose_rmse_dy": 0.11358039081096649,
      "pose_rmse_mean": 0.12460541725158691,
      "rmse_dtheta": 0.022566072642803192,
      "rmse_dx": 0.004942641127854586,
      "rmse_dy": 0.007895689457654953,
      "rmse_mean": 0.011801468208432198,
      "rotation_flip": 0.007358093746006489,
      "sparse_tokens": 32057.0,
      "step": 6722,
      "turn_loss": 0.10386941581964493,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.312349005761011,
      "grad_norm": 0.6881783604621887,
      "learning_rate": 4.129154969918463e-06,
      "loss": 0.0673,
      "mae_dtheta": 0.007508129812777042,
      "mae_dx": 0.0019545762334018946,
      "mae_dy": 0.0010500793578103185,
      "pose_mae_dtheta": 0.048867903649806976,
      "pose_mae_dx": 0.017520101740956306,
      "pose_mae_dy": 0.014187902212142944,
      "pose_rmse_dtheta": 0.14288799464702606,
      "pose_rmse_dx": 0.05182706192135811,
      "pose_rmse_dy": 0.03261365741491318,
      "pose_rmse_mean": 0.07577624171972275,
      "rmse_dtheta": 0.018446652218699455,
      "rmse_dx": 0.006481395568698645,
      "rmse_dy": 0.0020890848245471716,
      "rmse_mean": 0.009005711413919926,
      "rotation_flip": 0.005836575757712126,
      "sparse_tokens": 32153.0,
      "step": 6723,
      "turn_loss": 0.05991537496447563,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.31239546552685377,
      "grad_norm": 0.39212971925735474,
      "learning_rate": 4.127852990347483e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.03616854175925255,
      "mae_dx": 0.009710406884551048,
      "mae_dy": 0.002686786698177457,
      "pose_mae_dtheta": 0.2949521839618683,
      "pose_mae_dx": 0.07277734577655792,
      "pose_mae_dy": 0.030789993703365326,
      "pose_rmse_dtheta": 0.47232916951179504,
      "pose_rmse_dx": 0.17380391061306,
      "pose_rmse_dy": 0.08303876966238022,
      "pose_rmse_mean": 0.2430572807788849,
      "rmse_dtheta": 0.052815746515989304,
      "rmse_dx": 0.02131054177880287,
      "rmse_dy": 0.006348771508783102,
      "rmse_mean": 0.02682502195239067,
      "rotation_flip": 0.010683760978281498,
      "sparse_tokens": 20864.0,
      "step": 6724,
      "turn_loss": 0.27449142932891846,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.31244192529269654,
      "grad_norm": 0.473067045211792,
      "learning_rate": 4.126551071766214e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.01021180022507906,
      "mae_dx": 0.0016280323034152389,
      "mae_dy": 0.0021275572944432497,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4730670154094696,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.8248291015625,
      "model/head/act_norm_mean": 110.2263948074495,
      "model/head/act_norm_min": 75.48519134521484,
      "model/head/act_over_embed": 75.74861046744621,
      "model/head/grad_frac": 0.11035681515932083,
      "model/head/grad_norm": 0.052206169813871384,
      "model/head/grad_zero_frac": 0.00018592126434668899,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.704949889520202,
      "model/head/update_ratio": 0.0008907999726943672,
      "model/head/weight_delta": 9.277118682861328,
      "model/head/weight_delta_rel": 0.16274814307689667,
      "model/head/weight_norm": 58.60594177246094,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42150476574897766,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4214289048138787,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4213261604309082,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28960988886766637,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11560417711734772,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05468852445483208,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5390448246606335,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017668483778834343,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9905691146850586,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09771121293306351,
      "model/modality_embedder.encoders.pose/weight_norm": 30.952585220336914,
      "model/modality_embedder/grad_frac": 0.11560417711734772,
      "model/modality_embedder/grad_norm": 0.05468852445483208,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5390448246606335,
      "model/modality_embedder/update_ratio": 0.0017668483778834343,
      "model/modality_embedder/weight_delta": 2.9905691146850586,
      "model/modality_embedder/weight_delta_rel": 0.09771121293306351,
      "model/modality_embedder/weight_norm": 30.952585220336914,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.88352966308594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.652935606060606,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.03051471710205,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.254518790756872,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06546049565076828,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03096720017492771,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011103373253718019,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.415076971054077,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08800686150789261,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.889904022216797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.58228302001953,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.675637826679495,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.319822311401367,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.957329331455213,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06711956858634949,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.031752053648233414,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010707679903134704,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.0624544620513916,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10608581453561783,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.653533935546875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.11683654785156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.554783950617285,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.43317985534668,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.248696140668454,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06845809519290924,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.032385267317295074,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010577715002000332,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.3036797046661377,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1109313815832138,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.616506576538086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.0078125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.283928070386402,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.079575538635254,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.436980168276097,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0699467658996582,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03308950737118721,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011081666452810168,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8251938819885254,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09655171632766724,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.85968589782715,
      "model/normalizer/grad_frac": 0.24837279319763184,
      "model/normalizer/grad_norm": 0.11749697476625443,
      "model/normalizer/grad_zero_frac": 0.00025880071916617453,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014962812419980764,
      "model/normalizer/weight_delta": 5.976140022277832,
      "model/normalizer/weight_delta_rel": 0.0769692212343216,
      "model/normalizer/weight_norm": 78.52599334716797,
      "pose_mae_dtheta": 0.06709805876016617,
      "pose_mae_dx": 0.01744573377072811,
      "pose_mae_dy": 0.02360685169696808,
      "pose_rmse_dtheta": 0.18146122992038727,
      "pose_rmse_dx": 0.04271992668509483,
      "pose_rmse_dy": 0.049676183611154556,
      "pose_rmse_mean": 0.09128578752279282,
      "rmse_dtheta": 0.023371854797005653,
      "rmse_dx": 0.005127082113176584,
      "rmse_dy": 0.0048925988376140594,
      "rmse_mean": 0.01113051176071167,
      "rotation_flip": 0.00420489301905036,
      "sparse_tokens": 32089.0,
      "step": 6725,
      "turn_loss": 0.08681533485651016,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 39588.0,
      "epoch": 0.3124883850585393,
      "grad_norm": 0.538965106010437,
      "learning_rate": 4.1252492142656955e-06,
      "loss": 0.1456,
      "mae_dtheta": 0.035238202661275864,
      "mae_dx": 0.010105757042765617,
      "mae_dy": 0.003730854718014598,
      "pose_mae_dtheta": 0.26189208030700684,
      "pose_mae_dx": 0.08560358732938766,
      "pose_mae_dy": 0.05118228867650032,
      "pose_rmse_dtheta": 0.4540998637676239,
      "pose_rmse_dx": 0.20529192686080933,
      "pose_rmse_dy": 0.13352736830711365,
      "pose_rmse_mean": 0.2643063962459564,
      "rmse_dtheta": 0.05199819803237915,
      "rmse_dx": 0.022532789036631584,
      "rmse_dy": 0.007932357490062714,
      "rmse_mean": 0.027487782761454582,
      "rotation_flip": 0.008973640389740467,
      "sparse_tokens": 29972.0,
      "step": 6726,
      "turn_loss": 0.23484817147254944,
      "turns": 122.0,
      "turns_per_sample": 122.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3125348448243821,
      "grad_norm": 0.39556291699409485,
      "learning_rate": 4.12394741793697e-06,
      "loss": 0.0853,
      "mae_dtheta": 0.008236346766352654,
      "mae_dx": 0.0014312569983303547,
      "mae_dy": 0.001633673207834363,
      "pose_mae_dtheta": 0.05237887427210808,
      "pose_mae_dx": 0.01513975951820612,
      "pose_mae_dy": 0.01697590947151184,
      "pose_rmse_dtheta": 0.17798446118831635,
      "pose_rmse_dx": 0.04050789400935173,
      "pose_rmse_dy": 0.04021171107888222,
      "pose_rmse_mean": 0.0862346887588501,
      "rmse_dtheta": 0.021717825904488564,
      "rmse_dx": 0.004602690692991018,
      "rmse_dy": 0.004253247752785683,
      "rmse_mean": 0.010191255249083042,
      "rotation_flip": 0.005336617585271597,
      "sparse_tokens": 32137.0,
      "step": 6727,
      "turn_loss": 0.0717124491930008,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3125813045902249,
      "grad_norm": 0.4636389911174774,
      "learning_rate": 4.1226456828710705e-06,
      "loss": 0.0904,
      "mae_dtheta": 0.006823255680501461,
      "mae_dx": 0.0012401798740029335,
      "mae_dy": 0.001735963043756783,
      "pose_mae_dtheta": 0.04351525008678436,
      "pose_mae_dx": 0.01797005534172058,
      "pose_mae_dy": 0.02120603621006012,
      "pose_rmse_dtheta": 0.08380880951881409,
      "pose_rmse_dx": 0.04863838106393814,
      "pose_rmse_dy": 0.04747854918241501,
      "pose_rmse_mean": 0.05997524783015251,
      "rmse_dtheta": 0.014630228281021118,
      "rmse_dx": 0.003828809130936861,
      "rmse_dy": 0.003989359363913536,
      "rmse_mean": 0.007482798770070076,
      "rotation_flip": 0.0031104199588298798,
      "sparse_tokens": 32105.0,
      "step": 6728,
      "turn_loss": 0.056662023067474365,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18831.0,
      "epoch": 0.31262776435606765,
      "grad_norm": 0.6081945300102234,
      "learning_rate": 4.121344009159031e-06,
      "loss": 0.1569,
      "mae_dtheta": 0.02910909242928028,
      "mae_dx": 0.009012396447360516,
      "mae_dy": 0.00580952363088727,
      "pose_mae_dtheta": 0.21800467371940613,
      "pose_mae_dx": 0.08038228005170822,
      "pose_mae_dy": 0.08387618511915207,
      "pose_rmse_dtheta": 0.4028167128562927,
      "pose_rmse_dx": 0.19994983077049255,
      "pose_rmse_dy": 0.20872455835342407,
      "pose_rmse_mean": 0.27049702405929565,
      "rmse_dtheta": 0.04583035036921501,
      "rmse_dx": 0.021433835849165916,
      "rmse_dy": 0.010887681506574154,
      "rmse_mean": 0.026050623506307602,
      "rotation_flip": 0.010380622930824757,
      "sparse_tokens": 15981.0,
      "step": 6729,
      "turn_loss": 0.21866819262504578,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3126742241219104,
      "grad_norm": 0.6042777895927429,
      "learning_rate": 4.120042396891875e-06,
      "loss": 0.1872,
      "mae_dtheta": 0.00969313271343708,
      "mae_dx": 0.0014835471520200372,
      "mae_dy": 0.002188334474340081,
      "pose_mae_dtheta": 0.061909470707178116,
      "pose_mae_dx": 0.01701555959880352,
      "pose_mae_dy": 0.02676195651292801,
      "pose_rmse_dtheta": 0.14444895088672638,
      "pose_rmse_dx": 0.04686234891414642,
      "pose_rmse_dy": 0.07550367712974548,
      "pose_rmse_mean": 0.08893832564353943,
      "rmse_dtheta": 0.020960088819265366,
      "rmse_dx": 0.0045626843348145485,
      "rmse_dy": 0.005676744971424341,
      "rmse_mean": 0.010399838909506798,
      "rotation_flip": 0.004599463194608688,
      "sparse_tokens": 32121.0,
      "step": 6730,
      "turn_loss": 0.0801994651556015,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.3127206838877532,
      "grad_norm": 0.6163259744644165,
      "learning_rate": 4.118740846160626e-06,
      "loss": 0.1642,
      "mae_dtheta": 0.02827068604528904,
      "mae_dx": 0.00634457403793931,
      "mae_dy": 0.00443257624283433,
      "pose_mae_dtheta": 0.18262358009815216,
      "pose_mae_dx": 0.036591146141290665,
      "pose_mae_dy": 0.04200280085206032,
      "pose_rmse_dtheta": 0.3615996241569519,
      "pose_rmse_dx": 0.11360728740692139,
      "pose_rmse_dy": 0.09155110269784927,
      "pose_rmse_mean": 0.18891935050487518,
      "rmse_dtheta": 0.047341443598270416,
      "rmse_dx": 0.01626066491007805,
      "rmse_dy": 0.010878332890570164,
      "rmse_mean": 0.024826813489198685,
      "rotation_flip": 0.003355704713612795,
      "sparse_tokens": 10303.0,
      "step": 6731,
      "turn_loss": 0.23796896636486053,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 29754.0,
      "epoch": 0.312767143653596,
      "grad_norm": 0.6367921829223633,
      "learning_rate": 4.117439357056306e-06,
      "loss": 0.1259,
      "mae_dtheta": 0.04423141852021217,
      "mae_dx": 0.016033772379159927,
      "mae_dy": 0.004958431236445904,
      "pose_mae_dtheta": 0.38258329033851624,
      "pose_mae_dx": 0.1288774013519287,
      "pose_mae_dy": 0.05014079809188843,
      "pose_rmse_dtheta": 0.6105614304542542,
      "pose_rmse_dx": 0.2615121006965637,
      "pose_rmse_dy": 0.12209325283765793,
      "pose_rmse_mean": 0.3313889503479004,
      "rmse_dtheta": 0.06167202442884445,
      "rmse_dx": 0.028710532933473587,
      "rmse_dy": 0.010045837610960007,
      "rmse_mean": 0.03347613662481308,
      "rotation_flip": 0.008968610316514969,
      "sparse_tokens": 21909.0,
      "step": 6732,
      "turn_loss": 0.3539871275424957,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.31281360341943876,
      "grad_norm": 0.4457990527153015,
      "learning_rate": 4.116137929669921e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.031515441834926605,
      "mae_dx": 0.01075986959040165,
      "mae_dy": 0.0040754289366304874,
      "pose_mae_dtheta": 0.24940426647663116,
      "pose_mae_dx": 0.0875280499458313,
      "pose_mae_dy": 0.05925288051366806,
      "pose_rmse_dtheta": 0.4569091498851776,
      "pose_rmse_dx": 0.21877290308475494,
      "pose_rmse_dy": 0.12585195899009705,
      "pose_rmse_mean": 0.2671780288219452,
      "rmse_dtheta": 0.04854307696223259,
      "rmse_dx": 0.024037007242441177,
      "rmse_dy": 0.008511494845151901,
      "rmse_mean": 0.027030527591705322,
      "rotation_flip": 0.012358393520116806,
      "sparse_tokens": 16964.0,
      "step": 6733,
      "turn_loss": 0.23613743484020233,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.31286006318528153,
      "grad_norm": 0.6530392169952393,
      "learning_rate": 4.114836564092488e-06,
      "loss": 0.1268,
      "mae_dtheta": 0.007603632751852274,
      "mae_dx": 0.001548999221995473,
      "mae_dy": 0.0018937706481665373,
      "pose_mae_dtheta": 0.05236189812421799,
      "pose_mae_dx": 0.019954804331064224,
      "pose_mae_dy": 0.022068258374929428,
      "pose_rmse_dtheta": 0.12398169934749603,
      "pose_rmse_dx": 0.06458494067192078,
      "pose_rmse_dy": 0.05412856116890907,
      "pose_rmse_mean": 0.08089840412139893,
      "rmse_dtheta": 0.017721161246299744,
      "rmse_dx": 0.005394470412284136,
      "rmse_dy": 0.005003489088267088,
      "rmse_mean": 0.009373040869832039,
      "rotation_flip": 0.005361930467188358,
      "sparse_tokens": 32057.0,
      "step": 6734,
      "turn_loss": 0.06085841730237007,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.3129065229511243,
      "grad_norm": 0.7073379158973694,
      "learning_rate": 4.113535260415008e-06,
      "loss": 0.1543,
      "mae_dtheta": 0.03328108415007591,
      "mae_dx": 0.013722658157348633,
      "mae_dy": 0.004178325179964304,
      "pose_mae_dtheta": 0.23360587656497955,
      "pose_mae_dx": 0.10537445545196533,
      "pose_mae_dy": 0.05481267720460892,
      "pose_rmse_dtheta": 0.4320739805698395,
      "pose_rmse_dx": 0.22400759160518646,
      "pose_rmse_dy": 0.13054640591144562,
      "pose_rmse_mean": 0.26220932602882385,
      "rmse_dtheta": 0.051615286618471146,
      "rmse_dx": 0.026326889172196388,
      "rmse_dy": 0.0084255775436759,
      "rmse_mean": 0.028789252042770386,
      "rotation_flip": 0.005865102633833885,
      "sparse_tokens": 6340.0,
      "step": 6735,
      "turn_loss": 0.2846088111400604,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.3129529827169671,
      "grad_norm": 0.5470871329307556,
      "learning_rate": 4.1122340187284845e-06,
      "loss": 0.1817,
      "mae_dtheta": 0.03311663493514061,
      "mae_dx": 0.009728499688208103,
      "mae_dy": 0.008217842318117619,
      "pose_mae_dtheta": 0.2582918703556061,
      "pose_mae_dx": 0.08718416094779968,
      "pose_mae_dy": 0.099082812666893,
      "pose_rmse_dtheta": 0.47647571563720703,
      "pose_rmse_dx": 0.20298665761947632,
      "pose_rmse_dy": 0.21062089502811432,
      "pose_rmse_mean": 0.29669442772865295,
      "rmse_dtheta": 0.052622392773628235,
      "rmse_dx": 0.02206503227353096,
      "rmse_dy": 0.017582470551133156,
      "rmse_mean": 0.0307566300034523,
      "rotation_flip": 0.015209125354886055,
      "sparse_tokens": 22898.0,
      "step": 6736,
      "turn_loss": 0.29994484782218933,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.31299944248280986,
      "grad_norm": 0.33437973260879517,
      "learning_rate": 4.110932839123911e-06,
      "loss": 0.0639,
      "mae_dtheta": 0.028987891972064972,
      "mae_dx": 0.009352972730994225,
      "mae_dy": 0.0025178154464811087,
      "pose_mae_dtheta": 0.20797842741012573,
      "pose_mae_dx": 0.06559905409812927,
      "pose_mae_dy": 0.024108653888106346,
      "pose_rmse_dtheta": 0.37595731019973755,
      "pose_rmse_dx": 0.18406634032726288,
      "pose_rmse_dy": 0.060696471482515335,
      "pose_rmse_mean": 0.20690672099590302,
      "rmse_dtheta": 0.04521780088543892,
      "rmse_dx": 0.021039897575974464,
      "rmse_dy": 0.005694098304957151,
      "rmse_mean": 0.02398393303155899,
      "rotation_flip": 0.013215859420597553,
      "sparse_tokens": 10322.0,
      "step": 6737,
      "turn_loss": 0.2094338983297348,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.31304590224865264,
      "grad_norm": 1.2137075662612915,
      "learning_rate": 4.1096317216922815e-06,
      "loss": 0.2527,
      "mae_dtheta": 0.03044564090669155,
      "mae_dx": 0.007172276731580496,
      "mae_dy": 0.005091594532132149,
      "pose_mae_dtheta": 0.2406303435564041,
      "pose_mae_dx": 0.05914745479822159,
      "pose_mae_dy": 0.04991573467850685,
      "pose_rmse_dtheta": 0.4472194015979767,
      "pose_rmse_dx": 0.1292002648115158,
      "pose_rmse_dy": 0.14089719951152802,
      "pose_rmse_mean": 0.23910562694072723,
      "rmse_dtheta": 0.050544846802949905,
      "rmse_dx": 0.016612406820058823,
      "rmse_dy": 0.012418143451213837,
      "rmse_mean": 0.026525132358074188,
      "rotation_flip": 0.01719457097351551,
      "sparse_tokens": 18030.0,
      "step": 6738,
      "turn_loss": 0.261730432510376,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.3130923620144955,
      "grad_norm": 0.4873708188533783,
      "learning_rate": 4.1083306665245855e-06,
      "loss": 0.0962,
      "mae_dtheta": 0.03606525436043739,
      "mae_dx": 0.01709318533539772,
      "mae_dy": 0.006481442134827375,
      "pose_mae_dtheta": 0.2916404604911804,
      "pose_mae_dx": 0.14277493953704834,
      "pose_mae_dy": 0.08784209936857224,
      "pose_rmse_dtheta": 0.4660700559616089,
      "pose_rmse_dx": 0.2615434229373932,
      "pose_rmse_dy": 0.17527909576892853,
      "pose_rmse_mean": 0.3009641766548157,
      "rmse_dtheta": 0.05186938866972923,
      "rmse_dx": 0.02990032359957695,
      "rmse_dy": 0.011050914414227009,
      "rmse_mean": 0.030940210446715355,
      "rotation_flip": 0.0072115384973585606,
      "sparse_tokens": 6932.0,
      "step": 6739,
      "turn_loss": 0.34066134691238403,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.31313882178033825,
      "grad_norm": 0.7962058186531067,
      "learning_rate": 4.107029673711802e-06,
      "loss": 0.1481,
      "mae_dtheta": 0.006656073033809662,
      "mae_dx": 0.0009823177242651582,
      "mae_dy": 0.0006352635100483894,
      "pose_mae_dtheta": 0.04737190157175064,
      "pose_mae_dx": 0.009502315893769264,
      "pose_mae_dy": 0.010352036915719509,
      "pose_rmse_dtheta": 0.18998147547245026,
      "pose_rmse_dx": 0.023458395153284073,
      "pose_rmse_dy": 0.028921568766236305,
      "pose_rmse_mean": 0.08078715205192566,
      "rmse_dtheta": 0.023088937625288963,
      "rmse_dx": 0.003031873842701316,
      "rmse_dy": 0.0014716841978952289,
      "rmse_mean": 0.009197498671710491,
      "rotation_flip": 0.004470938816666603,
      "sparse_tokens": 32153.0,
      "step": 6740,
      "turn_loss": 0.03718546777963638,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.313185281546181,
      "grad_norm": 0.5680792331695557,
      "learning_rate": 4.1057287433449145e-06,
      "loss": 0.1443,
      "mae_dtheta": 0.03165629133582115,
      "mae_dx": 0.013751020655035973,
      "mae_dy": 0.0027737305499613285,
      "pose_mae_dtheta": 0.23382136225700378,
      "pose_mae_dx": 0.10789233446121216,
      "pose_mae_dy": 0.034594472497701645,
      "pose_rmse_dtheta": 0.45950087904930115,
      "pose_rmse_dx": 0.26743680238723755,
      "pose_rmse_dy": 0.08379688858985901,
      "pose_rmse_mean": 0.270244836807251,
      "rmse_dtheta": 0.052713844925165176,
      "rmse_dx": 0.028117813169956207,
      "rmse_dy": 0.005720937624573708,
      "rmse_mean": 0.028850866481661797,
      "rotation_flip": 0.0182232353836298,
      "sparse_tokens": 10690.0,
      "step": 6741,
      "turn_loss": 0.18495409190654755,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.3132317413120238,
      "grad_norm": 0.48371368646621704,
      "learning_rate": 4.104427875514894e-06,
      "loss": 0.1549,
      "mae_dtheta": 0.036116182804107666,
      "mae_dx": 0.013581243343651295,
      "mae_dy": 0.004570933524519205,
      "pose_mae_dtheta": 0.307361900806427,
      "pose_mae_dx": 0.11380502581596375,
      "pose_mae_dy": 0.03480800241231918,
      "pose_rmse_dtheta": 0.5513142943382263,
      "pose_rmse_dx": 0.23496954143047333,
      "pose_rmse_dy": 0.08119963109493256,
      "pose_rmse_mean": 0.28916117548942566,
      "rmse_dtheta": 0.058163490146398544,
      "rmse_dx": 0.025763699784874916,
      "rmse_dy": 0.0089345034211874,
      "rmse_mean": 0.030953899025917053,
      "rotation_flip": 0.007267442066222429,
      "sparse_tokens": 11560.0,
      "step": 6742,
      "turn_loss": 0.2076091766357422,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3132782010778666,
      "grad_norm": 1.0373566150665283,
      "learning_rate": 4.103127070312713e-06,
      "loss": 0.1444,
      "mae_dtheta": 0.010777735151350498,
      "mae_dx": 0.004138157237321138,
      "mae_dy": 0.003293012734502554,
      "pose_mae_dtheta": 0.0830685943365097,
      "pose_mae_dx": 0.04595412313938141,
      "pose_mae_dy": 0.032430291175842285,
      "pose_rmse_dtheta": 0.23172692954540253,
      "pose_rmse_dx": 0.1558362990617752,
      "pose_rmse_dy": 0.1167631670832634,
      "pose_rmse_mean": 0.16810880601406097,
      "rmse_dtheta": 0.026489274576306343,
      "rmse_dx": 0.013776500709354877,
      "rmse_dy": 0.010508179664611816,
      "rmse_mean": 0.016924653202295303,
      "rotation_flip": 0.0057742781937122345,
      "sparse_tokens": 32057.0,
      "step": 6743,
      "turn_loss": 0.11283166706562042,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.31332466084370936,
      "grad_norm": 0.3633796274662018,
      "learning_rate": 4.101826327829339e-06,
      "loss": 0.0963,
      "mae_dtheta": 0.014601055532693863,
      "mae_dx": 0.002462132601067424,
      "mae_dy": 0.003785183187574148,
      "pose_mae_dtheta": 0.10006450861692429,
      "pose_mae_dx": 0.02818838134407997,
      "pose_mae_dy": 0.03807194530963898,
      "pose_rmse_dtheta": 0.21935760974884033,
      "pose_rmse_dx": 0.06844835728406906,
      "pose_rmse_dy": 0.08610141277313232,
      "pose_rmse_mean": 0.12463580071926117,
      "rmse_dtheta": 0.029491964727640152,
      "rmse_dx": 0.0072927759028971195,
      "rmse_dy": 0.00897393561899662,
      "rmse_mean": 0.015252893790602684,
      "rotation_flip": 0.004238784778863192,
      "sparse_tokens": 32089.0,
      "step": 6744,
      "turn_loss": 0.11434439569711685,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.31337112060955213,
      "grad_norm": 0.5287818908691406,
      "learning_rate": 4.100525648155731e-06,
      "loss": 0.0813,
      "mae_dtheta": 0.008665087632834911,
      "mae_dx": 0.001319859642535448,
      "mae_dy": 0.0010082874214276671,
      "pose_mae_dtheta": 0.05524374172091484,
      "pose_mae_dx": 0.012719832360744476,
      "pose_mae_dy": 0.014485036954283714,
      "pose_rmse_dtheta": 0.19877345860004425,
      "pose_rmse_dx": 0.03437064588069916,
      "pose_rmse_dy": 0.04443866014480591,
      "pose_rmse_mean": 0.0925275906920433,
      "rmse_dtheta": 0.025287246331572533,
      "rmse_dx": 0.0042148781940341,
      "rmse_dy": 0.002407690044492483,
      "rmse_mean": 0.010636604391038418,
      "rotation_flip": 0.004259850829839706,
      "sparse_tokens": 32121.0,
      "step": 6745,
      "turn_loss": 0.05795186758041382,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.3134175803753949,
      "grad_norm": 1.275831699371338,
      "learning_rate": 4.099225031382848e-06,
      "loss": 0.286,
      "mae_dtheta": 0.03513411059975624,
      "mae_dx": 0.010155959986150265,
      "mae_dy": 0.0047304751351475716,
      "pose_mae_dtheta": 0.29639768600463867,
      "pose_mae_dx": 0.08572410047054291,
      "pose_mae_dy": 0.07485464960336685,
      "pose_rmse_dtheta": 0.5115516185760498,
      "pose_rmse_dx": 0.20203877985477448,
      "pose_rmse_dy": 0.19259078800678253,
      "pose_rmse_mean": 0.30206039547920227,
      "rmse_dtheta": 0.053865596652030945,
      "rmse_dx": 0.02306276373565197,
      "rmse_dy": 0.009960330091416836,
      "rmse_mean": 0.02896289899945259,
      "rotation_flip": 0.011520737782120705,
      "sparse_tokens": 15026.0,
      "step": 6746,
      "turn_loss": 0.2993392050266266,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 11023.0,
      "epoch": 0.3134640401412377,
      "grad_norm": 0.44011902809143066,
      "learning_rate": 4.097924477601641e-06,
      "loss": 0.1248,
      "mae_dtheta": 0.03691158443689346,
      "mae_dx": 0.013601677492260933,
      "mae_dy": 0.0045202188193798065,
      "pose_mae_dtheta": 0.3111066222190857,
      "pose_mae_dx": 0.11722568422555923,
      "pose_mae_dy": 0.06591776013374329,
      "pose_rmse_dtheta": 0.5483167171478271,
      "pose_rmse_dx": 0.2449033260345459,
      "pose_rmse_dy": 0.14812248945236206,
      "pose_rmse_mean": 0.31378084421157837,
      "rmse_dtheta": 0.05453900992870331,
      "rmse_dx": 0.025552384555339813,
      "rmse_dy": 0.008456801995635033,
      "rmse_mean": 0.0295160673558712,
      "rotation_flip": 0.007366482634097338,
      "sparse_tokens": 9098.0,
      "step": 6747,
      "turn_loss": 0.23537330329418182,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.31351049990708046,
      "grad_norm": 0.6374884843826294,
      "learning_rate": 4.096623986903061e-06,
      "loss": 0.1214,
      "mae_dtheta": 0.013269293121993542,
      "mae_dx": 0.001601998694241047,
      "mae_dy": 0.002647872781381011,
      "pose_mae_dtheta": 0.08866322040557861,
      "pose_mae_dx": 0.024382146075367928,
      "pose_mae_dy": 0.030500348657369614,
      "pose_rmse_dtheta": 0.2426566779613495,
      "pose_rmse_dx": 0.058402951806783676,
      "pose_rmse_dy": 0.07001915574073792,
      "pose_rmse_mean": 0.12369292974472046,
      "rmse_dtheta": 0.02918517403304577,
      "rmse_dx": 0.0038692548405379057,
      "rmse_dy": 0.005293899215757847,
      "rmse_mean": 0.012782776728272438,
      "rotation_flip": 0.009336445480585098,
      "sparse_tokens": 32121.0,
      "step": 6748,
      "turn_loss": 0.09323952347040176,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.31355695967292324,
      "grad_norm": 0.4265960156917572,
      "learning_rate": 4.095323559378049e-06,
      "loss": 0.1064,
      "mae_dtheta": 0.05254878103733063,
      "mae_dx": 0.01330824289470911,
      "mae_dy": 0.005933535285294056,
      "pose_mae_dtheta": 0.4395383596420288,
      "pose_mae_dx": 0.07969549298286438,
      "pose_mae_dy": 0.06092981621623039,
      "pose_rmse_dtheta": 0.72319096326828,
      "pose_rmse_dx": 0.17186443507671356,
      "pose_rmse_dy": 0.15558001399040222,
      "pose_rmse_mean": 0.35021182894706726,
      "rmse_dtheta": 0.07333933562040329,
      "rmse_dx": 0.025051526725292206,
      "rmse_dy": 0.01224085595458746,
      "rmse_mean": 0.03687724098563194,
      "rotation_flip": 0.021943572908639908,
      "sparse_tokens": 5151.0,
      "step": 6749,
      "turn_loss": 0.2920089364051819,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.313603419438766,
      "grad_norm": 0.45547348260879517,
      "learning_rate": 4.094023195117545e-06,
      "loss": 0.122,
      "mae_dtheta": 0.009864311665296555,
      "mae_dx": 0.0013737418921664357,
      "mae_dy": 0.0019199257949367166,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.45547348260879517,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 154.80709838867188,
      "model/head/act_norm_mean": 116.65893308080808,
      "model/head/act_norm_min": 72.44102478027344,
      "model/head/act_over_embed": 80.16911099127036,
      "model/head/grad_frac": 0.09463271498680115,
      "model/head/grad_norm": 0.0431026928126812,
      "model/head/grad_zero_frac": 0.00018623852520249784,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7041706123737373,
      "model/head/update_ratio": 0.0007354362751357257,
      "model/head/weight_delta": 9.287841796875,
      "model/head/weight_delta_rel": 0.1629362553358078,
      "model/head/weight_norm": 58.60832977294922,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42154446244239807,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4214738819697132,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.421404093503952,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2896407975902386,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0882868841290474,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04021233320236206,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5372253139269406,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012991573894396424,
      "model/modality_embedder.encoders.pose/weight_delta": 2.992867946624756,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0977863222360611,
      "model/modality_embedder.encoders.pose/weight_norm": 30.952625274658203,
      "model/modality_embedder/grad_frac": 0.0882868841290474,
      "model/modality_embedder/grad_norm": 0.04021233320236206,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5372253139269406,
      "model/modality_embedder/update_ratio": 0.0012991573894396424,
      "model/modality_embedder/weight_delta": 2.992867946624756,
      "model/modality_embedder/weight_delta_rel": 0.0977863222360611,
      "model/modality_embedder/weight_norm": 30.952625274658203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.19356536865234,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.299445346320347,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.995149612426758,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.698806336982916,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06560204178094864,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.029879990965127945,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000322788895573467,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001071300357580185,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4199838638305664,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08818567544221878,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.891328811645508,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.85909271240234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.332175925925927,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.388663291931152,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.40850845986389,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06473968923091888,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.029487211257219315,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.00099434913136065,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.068072557449341,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10628043115139008,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.65478515625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.77422332763672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.213080707872376,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.524796485900879,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.701083835325495,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06062699854373932,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.027613990008831024,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009018739219754934,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.3100314140319824,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11114465445280075,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.618459701538086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.45491790771484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.941202701619368,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.425130844116211,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.888665448361436,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06001421436667442,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02733488380908966,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009153969003818929,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8304624557495117,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0967317745089531,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.861236572265625,
      "model/normalizer/grad_frac": 0.24520879983901978,
      "model/normalizer/grad_norm": 0.1116861030459404,
      "model/normalizer/grad_zero_frac": 0.00025998245109803975,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014222452882677317,
      "model/normalizer/weight_delta": 5.987438201904297,
      "model/normalizer/weight_delta_rel": 0.07711473852396011,
      "model/normalizer/weight_norm": 78.52801513671875,
      "pose_mae_dtheta": 0.0679982379078865,
      "pose_mae_dx": 0.018975067883729935,
      "pose_mae_dy": 0.024797724559903145,
      "pose_rmse_dtheta": 0.17437192797660828,
      "pose_rmse_dx": 0.04866078495979309,
      "pose_rmse_dy": 0.05965578928589821,
      "pose_rmse_mean": 0.09422950446605682,
      "rmse_dtheta": 0.022131260484457016,
      "rmse_dx": 0.004494468215852976,
      "rmse_dy": 0.0040696836076676846,
      "rmse_mean": 0.010231804102659225,
      "rotation_flip": 0.008627773262560368,
      "sparse_tokens": 32073.0,
      "step": 6750,
      "turn_loss": 0.07626072317361832,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3136498792046088,
      "grad_norm": 0.7455897331237793,
      "learning_rate": 4.092722894212488e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.011433721520006657,
      "mae_dx": 0.002539894776418805,
      "mae_dy": 0.002252074657008052,
      "pose_mae_dtheta": 0.07957829535007477,
      "pose_mae_dx": 0.024077678099274635,
      "pose_mae_dy": 0.024161193519830704,
      "pose_rmse_dtheta": 0.2099703997373581,
      "pose_rmse_dx": 0.06266624480485916,
      "pose_rmse_dy": 0.08142819255590439,
      "pose_rmse_mean": 0.11802162230014801,
      "rmse_dtheta": 0.027050016447901726,
      "rmse_dx": 0.008044281974434853,
      "rmse_dy": 0.006280425004661083,
      "rmse_mean": 0.013791575096547604,
      "rotation_flip": 0.006587072741240263,
      "sparse_tokens": 32169.0,
      "step": 6751,
      "turn_loss": 0.1059543564915657,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.31369633897045157,
      "grad_norm": 0.7283753752708435,
      "learning_rate": 4.091422656753804e-06,
      "loss": 0.1643,
      "mae_dtheta": 0.043183304369449615,
      "mae_dx": 0.009118365123867989,
      "mae_dy": 0.002885269932448864,
      "pose_mae_dtheta": 0.3842874765396118,
      "pose_mae_dx": 0.06092239171266556,
      "pose_mae_dy": 0.039388835430145264,
      "pose_rmse_dtheta": 0.6934796571731567,
      "pose_rmse_dx": 0.1586117446422577,
      "pose_rmse_dy": 0.11914899945259094,
      "pose_rmse_mean": 0.32374680042266846,
      "rmse_dtheta": 0.06548964977264404,
      "rmse_dx": 0.020583759993314743,
      "rmse_dy": 0.006750449538230896,
      "rmse_mean": 0.03094128891825676,
      "rotation_flip": 0.007981755770742893,
      "sparse_tokens": 14790.0,
      "step": 6752,
      "turn_loss": 0.26182428002357483,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.31374279873629435,
      "grad_norm": 0.3635524809360504,
      "learning_rate": 4.0901224828324225e-06,
      "loss": 0.0752,
      "mae_dtheta": 0.0028623673133552074,
      "mae_dx": 0.003915295470505953,
      "mae_dy": 0.00023793398577254266,
      "pose_mae_dtheta": 0.02239038608968258,
      "pose_mae_dx": 0.03396124765276909,
      "pose_mae_dy": 0.00392287690192461,
      "pose_rmse_dtheta": 0.10683777928352356,
      "pose_rmse_dx": 0.14158819615840912,
      "pose_rmse_dy": 0.007819877937436104,
      "pose_rmse_mean": 0.08541528880596161,
      "rmse_dtheta": 0.012774692848324776,
      "rmse_dx": 0.014234552159905434,
      "rmse_dy": 0.0004614771460182965,
      "rmse_mean": 0.00915690790861845,
      "rotation_flip": 0.0028490028344094753,
      "sparse_tokens": 32057.0,
      "step": 6753,
      "turn_loss": 0.04651889577507973,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3137892585021371,
      "grad_norm": 0.6212802529335022,
      "learning_rate": 4.088822372539263e-06,
      "loss": 0.1233,
      "mae_dtheta": 0.010938726365566254,
      "mae_dx": 0.0017637205310165882,
      "mae_dy": 0.001957191387191415,
      "pose_mae_dtheta": 0.08011981844902039,
      "pose_mae_dx": 0.021406011655926704,
      "pose_mae_dy": 0.027337664738297462,
      "pose_rmse_dtheta": 0.2504308521747589,
      "pose_rmse_dx": 0.07023297995328903,
      "pose_rmse_dy": 0.08522846549749374,
      "pose_rmse_mean": 0.13529744744300842,
      "rmse_dtheta": 0.02816607989370823,
      "rmse_dx": 0.006062666419893503,
      "rmse_dy": 0.005006185732781887,
      "rmse_mean": 0.013078311458230019,
      "rotation_flip": 0.002256317762658,
      "sparse_tokens": 32105.0,
      "step": 6754,
      "turn_loss": 0.0814133957028389,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13000.0,
      "epoch": 0.3138357182679799,
      "grad_norm": 0.5644626617431641,
      "learning_rate": 4.0875223259652455e-06,
      "loss": 0.1584,
      "mae_dtheta": 0.03154393285512924,
      "mae_dx": 0.007355682086199522,
      "mae_dy": 0.003976339008659124,
      "pose_mae_dtheta": 0.23596227169036865,
      "pose_mae_dx": 0.05356976389884949,
      "pose_mae_dy": 0.05342855677008629,
      "pose_rmse_dtheta": 0.494005411863327,
      "pose_rmse_dx": 0.13576583564281464,
      "pose_rmse_dy": 0.14068810641765594,
      "pose_rmse_mean": 0.25681978464126587,
      "rmse_dtheta": 0.053435083478689194,
      "rmse_dx": 0.01821589097380638,
      "rmse_dy": 0.008180861361324787,
      "rmse_mean": 0.026610612869262695,
      "rotation_flip": 0.01247771829366684,
      "sparse_tokens": 10215.0,
      "step": 6755,
      "turn_loss": 0.19109511375427246,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.31388217803382273,
      "grad_norm": 1.1565617322921753,
      "learning_rate": 4.086222343201279e-06,
      "loss": 0.2528,
      "mae_dtheta": 0.03143683820962906,
      "mae_dx": 0.010081136599183083,
      "mae_dy": 0.009344113059341908,
      "pose_mae_dtheta": 0.24752914905548096,
      "pose_mae_dx": 0.07104510813951492,
      "pose_mae_dy": 0.11509308964014053,
      "pose_rmse_dtheta": 0.41658785939216614,
      "pose_rmse_dx": 0.1829954981803894,
      "pose_rmse_dy": 0.28182876110076904,
      "pose_rmse_mean": 0.2938040494918823,
      "rmse_dtheta": 0.04615548998117447,
      "rmse_dx": 0.022719934582710266,
      "rmse_dy": 0.021151797845959663,
      "rmse_mean": 0.0300090741366148,
      "rotation_flip": 0.010101010091602802,
      "sparse_tokens": 5929.0,
      "step": 6756,
      "turn_loss": 0.34752780199050903,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3139286377996655,
      "grad_norm": 0.5817645192146301,
      "learning_rate": 4.084922424338277e-06,
      "loss": 0.1413,
      "mae_dtheta": 0.006580861285328865,
      "mae_dx": 0.0011495639337226748,
      "mae_dy": 0.0012088969815522432,
      "pose_mae_dtheta": 0.048980530351400375,
      "pose_mae_dx": 0.011989069171249866,
      "pose_mae_dy": 0.01858195662498474,
      "pose_rmse_dtheta": 0.13511033356189728,
      "pose_rmse_dx": 0.026688100770115852,
      "pose_rmse_dy": 0.04100004956126213,
      "pose_rmse_mean": 0.06759949773550034,
      "rmse_dtheta": 0.016914939507842064,
      "rmse_dx": 0.003565984545275569,
      "rmse_dy": 0.002403564052656293,
      "rmse_mean": 0.007628162857145071,
      "rotation_flip": 0.0038804812356829643,
      "sparse_tokens": 32153.0,
      "step": 6757,
      "turn_loss": 0.04940072074532509,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3139750975655083,
      "grad_norm": 0.46380355954170227,
      "learning_rate": 4.083622569467141e-06,
      "loss": 0.1328,
      "mae_dtheta": 0.007728891912847757,
      "mae_dx": 0.0019418351585045457,
      "mae_dy": 0.0016132242744788527,
      "pose_mae_dtheta": 0.05464116111397743,
      "pose_mae_dx": 0.01596779376268387,
      "pose_mae_dy": 0.01740182749927044,
      "pose_rmse_dtheta": 0.18628434836864471,
      "pose_rmse_dx": 0.06007767841219902,
      "pose_rmse_dy": 0.06350908428430557,
      "pose_rmse_mean": 0.1032903715968132,
      "rmse_dtheta": 0.024180322885513306,
      "rmse_dx": 0.007394614163786173,
      "rmse_dy": 0.006682869978249073,
      "rmse_mean": 0.012752602808177471,
      "rotation_flip": 0.005497525911778212,
      "sparse_tokens": 32105.0,
      "step": 6758,
      "turn_loss": 0.08662793040275574,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.31402155733135106,
      "grad_norm": 0.45118072628974915,
      "learning_rate": 4.082322778678769e-06,
      "loss": 0.1221,
      "mae_dtheta": 0.023915216326713562,
      "mae_dx": 0.01065107248723507,
      "mae_dy": 0.0022773391101509333,
      "pose_mae_dtheta": 0.18021701276302338,
      "pose_mae_dx": 0.08651470392942429,
      "pose_mae_dy": 0.026920732110738754,
      "pose_rmse_dtheta": 0.3348306119441986,
      "pose_rmse_dx": 0.18888504803180695,
      "pose_rmse_dy": 0.07987802475690842,
      "pose_rmse_mean": 0.20119790732860565,
      "rmse_dtheta": 0.04158720374107361,
      "rmse_dx": 0.02280893363058567,
      "rmse_dy": 0.005081272684037685,
      "rmse_mean": 0.02315913699567318,
      "rotation_flip": 0.009541984647512436,
      "sparse_tokens": 10041.0,
      "step": 6759,
      "turn_loss": 0.1776532679796219,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.31406801709719384,
      "grad_norm": 0.8309078812599182,
      "learning_rate": 4.081023052064059e-06,
      "loss": 0.1231,
      "mae_dtheta": 0.022126900032162666,
      "mae_dx": 0.008714929223060608,
      "mae_dy": 0.002908416325226426,
      "pose_mae_dtheta": 0.15013356506824493,
      "pose_mae_dx": 0.07528873533010483,
      "pose_mae_dy": 0.03667324036359787,
      "pose_rmse_dtheta": 0.30591028928756714,
      "pose_rmse_dx": 0.18425804376602173,
      "pose_rmse_dy": 0.0849638357758522,
      "pose_rmse_mean": 0.19171074032783508,
      "rmse_dtheta": 0.039321012794971466,
      "rmse_dx": 0.020113950595259666,
      "rmse_dy": 0.005987735465168953,
      "rmse_mean": 0.021807566285133362,
      "rotation_flip": 0.017841212451457977,
      "sparse_tokens": 23288.0,
      "step": 6760,
      "turn_loss": 0.16627632081508636,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.3141144768630366,
      "grad_norm": 0.580774188041687,
      "learning_rate": 4.079723389713899e-06,
      "loss": 0.1411,
      "mae_dtheta": 0.029260247945785522,
      "mae_dx": 0.0056525724940001965,
      "mae_dy": 0.0047948346473276615,
      "pose_mae_dtheta": 0.2034229338169098,
      "pose_mae_dx": 0.05692172050476074,
      "pose_mae_dy": 0.07666465640068054,
      "pose_rmse_dtheta": 0.3408935070037842,
      "pose_rmse_dx": 0.12693461775779724,
      "pose_rmse_dy": 0.14694584906101227,
      "pose_rmse_mean": 0.20492467284202576,
      "rmse_dtheta": 0.04434484243392944,
      "rmse_dx": 0.015029695816338062,
      "rmse_dy": 0.008151977322995663,
      "rmse_mean": 0.022508837282657623,
      "rotation_flip": 0.013727560639381409,
      "sparse_tokens": 16525.0,
      "step": 6761,
      "turn_loss": 0.23526328802108765,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3141609366288794,
      "grad_norm": 0.5619809627532959,
      "learning_rate": 4.078423791719179e-06,
      "loss": 0.1139,
      "mae_dtheta": 0.01006434764713049,
      "mae_dx": 0.0012997194426134229,
      "mae_dy": 0.0024772314354777336,
      "pose_mae_dtheta": 0.07000014185905457,
      "pose_mae_dx": 0.01917300373315811,
      "pose_mae_dy": 0.027795761823654175,
      "pose_rmse_dtheta": 0.16785360872745514,
      "pose_rmse_dx": 0.05462690442800522,
      "pose_rmse_dy": 0.06447160243988037,
      "pose_rmse_mean": 0.09565070271492004,
      "rmse_dtheta": 0.021160833537578583,
      "rmse_dx": 0.003432918805629015,
      "rmse_dy": 0.005596378818154335,
      "rmse_mean": 0.01006337720900774,
      "rotation_flip": 0.003977724816650152,
      "sparse_tokens": 32089.0,
      "step": 6762,
      "turn_loss": 0.06698370724916458,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.31420739639472217,
      "grad_norm": 0.6861584782600403,
      "learning_rate": 4.077124258170774e-06,
      "loss": 0.1512,
      "mae_dtheta": 0.024140648543834686,
      "mae_dx": 0.009075076319277287,
      "mae_dy": 0.005171861965209246,
      "pose_mae_dtheta": 0.13532964885234833,
      "pose_mae_dx": 0.05508897826075554,
      "pose_mae_dy": 0.06348569691181183,
      "pose_rmse_dtheta": 0.24509060382843018,
      "pose_rmse_dx": 0.13030298054218292,
      "pose_rmse_dy": 0.14532345533370972,
      "pose_rmse_mean": 0.1735723465681076,
      "rmse_dtheta": 0.038873158395290375,
      "rmse_dx": 0.021874675527215004,
      "rmse_dy": 0.010608171112835407,
      "rmse_mean": 0.023785335943102837,
      "rotation_flip": 0.017582418397068977,
      "sparse_tokens": 9006.0,
      "step": 6763,
      "turn_loss": 0.21101520955562592,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.31425385616056495,
      "grad_norm": 0.6094756126403809,
      "learning_rate": 4.075824789159566e-06,
      "loss": 0.14,
      "mae_dtheta": 0.01553704496473074,
      "mae_dx": 0.0038180872797966003,
      "mae_dy": 0.004289212170988321,
      "pose_mae_dtheta": 0.11321862787008286,
      "pose_mae_dx": 0.04192373901605606,
      "pose_mae_dy": 0.03318125382065773,
      "pose_rmse_dtheta": 0.2892407476902008,
      "pose_rmse_dx": 0.10862857848405838,
      "pose_rmse_dy": 0.07887255400419235,
      "pose_rmse_mean": 0.1589139699935913,
      "rmse_dtheta": 0.03291924297809601,
      "rmse_dx": 0.009814008139073849,
      "rmse_dy": 0.009439380839467049,
      "rmse_mean": 0.01739087700843811,
      "rotation_flip": 0.009277154691517353,
      "sparse_tokens": 32089.0,
      "step": 6764,
      "turn_loss": 0.15335878729820251,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3143003159264077,
      "grad_norm": 0.6298487782478333,
      "learning_rate": 4.074525384776428e-06,
      "loss": 0.1294,
      "mae_dtheta": 0.012829996645450592,
      "mae_dx": 0.0020426814444363117,
      "mae_dy": 0.002711772220209241,
      "pose_mae_dtheta": 0.08898168802261353,
      "pose_mae_dx": 0.026082098484039307,
      "pose_mae_dy": 0.0379319004714489,
      "pose_rmse_dtheta": 0.19426299631595612,
      "pose_rmse_dx": 0.06552167236804962,
      "pose_rmse_dy": 0.09711302071809769,
      "pose_rmse_mean": 0.11896589398384094,
      "rmse_dtheta": 0.025667907670140266,
      "rmse_dx": 0.006261520087718964,
      "rmse_dy": 0.005990387871861458,
      "rmse_mean": 0.012639937922358513,
      "rotation_flip": 0.00753012066707015,
      "sparse_tokens": 32089.0,
      "step": 6765,
      "turn_loss": 0.0943240225315094,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.3143467756922505,
      "grad_norm": 0.5305972695350647,
      "learning_rate": 4.073226045112225e-06,
      "loss": 0.0849,
      "mae_dtheta": 0.039872121065855026,
      "mae_dx": 0.004853666760027409,
      "mae_dy": 0.0026123791467398405,
      "pose_mae_dtheta": 0.2989545166492462,
      "pose_mae_dx": 0.04230943322181702,
      "pose_mae_dy": 0.028422852978110313,
      "pose_rmse_dtheta": 0.574260413646698,
      "pose_rmse_dx": 0.10956878960132599,
      "pose_rmse_dy": 0.10139936208724976,
      "pose_rmse_mean": 0.26174286007881165,
      "rmse_dtheta": 0.06345344334840775,
      "rmse_dx": 0.01244913600385189,
      "rmse_dy": 0.007237553130835295,
      "rmse_mean": 0.02771337889134884,
      "rotation_flip": 0.006613756529986858,
      "sparse_tokens": 11832.0,
      "step": 6766,
      "turn_loss": 0.20783719420433044,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 13000.0,
      "epoch": 0.3143932354580933,
      "grad_norm": 0.8470404744148254,
      "learning_rate": 4.071926770257824e-06,
      "loss": 0.1225,
      "mae_dtheta": 0.028911521658301353,
      "mae_dx": 0.003596539841964841,
      "mae_dy": 0.0019174676854163408,
      "pose_mae_dtheta": 0.21835309267044067,
      "pose_mae_dx": 0.026421837508678436,
      "pose_mae_dy": 0.02571692317724228,
      "pose_rmse_dtheta": 0.4702952802181244,
      "pose_rmse_dx": 0.07502437382936478,
      "pose_rmse_dy": 0.06328364461660385,
      "pose_rmse_mean": 0.2028677761554718,
      "rmse_dtheta": 0.05155942961573601,
      "rmse_dx": 0.01101583894342184,
      "rmse_dy": 0.003994757775217295,
      "rmse_mean": 0.02219000831246376,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 11028.0,
      "step": 6767,
      "turn_loss": 0.15675492584705353,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.31443969522393606,
      "grad_norm": 0.4710521101951599,
      "learning_rate": 4.07062756030408e-06,
      "loss": 0.0968,
      "mae_dtheta": 0.006553198676556349,
      "mae_dx": 0.0016202941769734025,
      "mae_dy": 0.001988290809094906,
      "pose_mae_dtheta": 0.04518675431609154,
      "pose_mae_dx": 0.01957032084465027,
      "pose_mae_dy": 0.018571440130472183,
      "pose_rmse_dtheta": 0.11304151266813278,
      "pose_rmse_dx": 0.06314340233802795,
      "pose_rmse_dy": 0.04817109927535057,
      "pose_rmse_mean": 0.07478534430265427,
      "rmse_dtheta": 0.015481377951800823,
      "rmse_dx": 0.0055730692110955715,
      "rmse_dy": 0.005482901353389025,
      "rmse_mean": 0.008845782838761806,
      "rotation_flip": 0.006925945635885,
      "sparse_tokens": 32057.0,
      "step": 6768,
      "turn_loss": 0.058292750269174576,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.31448615498977883,
      "grad_norm": 0.3537590801715851,
      "learning_rate": 4.06932841534185e-06,
      "loss": 0.0772,
      "mae_dtheta": 0.014267866499722004,
      "mae_dx": 0.001982922898605466,
      "mae_dy": 0.003490336239337921,
      "pose_mae_dtheta": 0.10225649923086166,
      "pose_mae_dx": 0.02954370155930519,
      "pose_mae_dy": 0.04098885878920555,
      "pose_rmse_dtheta": 0.2112683355808258,
      "pose_rmse_dx": 0.06952314078807831,
      "pose_rmse_dy": 0.08240596204996109,
      "pose_rmse_mean": 0.12106581032276154,
      "rmse_dtheta": 0.02533283270895481,
      "rmse_dx": 0.0052201636135578156,
      "rmse_dy": 0.006523941643536091,
      "rmse_mean": 0.012358980253338814,
      "rotation_flip": 0.0038885287940502167,
      "sparse_tokens": 32121.0,
      "step": 6769,
      "turn_loss": 0.11764487624168396,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3145326147556216,
      "grad_norm": 0.4356335699558258,
      "learning_rate": 4.0680293354619845e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.007071127649396658,
      "mae_dx": 0.0014467466389760375,
      "mae_dy": 0.0016399114392697811,
      "pose_mae_dtheta": 0.04834897071123123,
      "pose_mae_dx": 0.016689561307430267,
      "pose_mae_dy": 0.0182277150452137,
      "pose_rmse_dtheta": 0.15197214484214783,
      "pose_rmse_dx": 0.05088832601904869,
      "pose_rmse_dy": 0.050794169306755066,
      "pose_rmse_mean": 0.08455155789852142,
      "rmse_dtheta": 0.01866070367395878,
      "rmse_dx": 0.00527171092107892,
      "rmse_dy": 0.003982623107731342,
      "rmse_mean": 0.009305013343691826,
      "rotation_flip": 0.003411306068301201,
      "sparse_tokens": 32057.0,
      "step": 6770,
      "turn_loss": 0.06147018074989319,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3145790745214644,
      "grad_norm": 0.3722948133945465,
      "learning_rate": 4.066730320755327e-06,
      "loss": 0.0844,
      "mae_dtheta": 0.009777314029633999,
      "mae_dx": 0.00148452864959836,
      "mae_dy": 0.0020433112513273954,
      "pose_mae_dtheta": 0.06613733619451523,
      "pose_mae_dx": 0.021428968757390976,
      "pose_mae_dy": 0.02645176090300083,
      "pose_rmse_dtheta": 0.17275705933570862,
      "pose_rmse_dx": 0.051151618361473083,
      "pose_rmse_dy": 0.06332864612340927,
      "pose_rmse_mean": 0.09574577212333679,
      "rmse_dtheta": 0.02319384552538395,
      "rmse_dx": 0.004360491409897804,
      "rmse_dy": 0.004247928503900766,
      "rmse_mean": 0.010600755922496319,
      "rotation_flip": 0.0037499999161809683,
      "sparse_tokens": 32089.0,
      "step": 6771,
      "turn_loss": 0.07661450654268265,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3146255342873072,
      "grad_norm": 0.6330828666687012,
      "learning_rate": 4.06543137131272e-06,
      "loss": 0.0913,
      "mae_dtheta": 0.010449787601828575,
      "mae_dx": 0.002187585923820734,
      "mae_dy": 0.002390231704339385,
      "pose_mae_dtheta": 0.0719529241323471,
      "pose_mae_dx": 0.023167654871940613,
      "pose_mae_dy": 0.024436181411147118,
      "pose_rmse_dtheta": 0.20663109421730042,
      "pose_rmse_dx": 0.05683952569961548,
      "pose_rmse_dy": 0.056586142629384995,
      "pose_rmse_mean": 0.1066855937242508,
      "rmse_dtheta": 0.02385418489575386,
      "rmse_dx": 0.006011573597788811,
      "rmse_dy": 0.005533543881028891,
      "rmse_mean": 0.01179976761341095,
      "rotation_flip": 0.0060606058686971664,
      "sparse_tokens": 32185.0,
      "step": 6772,
      "turn_loss": 0.09751810878515244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.31467199405315,
      "grad_norm": 0.4962296187877655,
      "learning_rate": 4.064132487224998e-06,
      "loss": 0.139,
      "mae_dtheta": 0.010501180775463581,
      "mae_dx": 0.001667011994868517,
      "mae_dy": 0.0022986026015132666,
      "pose_mae_dtheta": 0.07272668927907944,
      "pose_mae_dx": 0.020760836079716682,
      "pose_mae_dy": 0.031462568789720535,
      "pose_rmse_dtheta": 0.19722270965576172,
      "pose_rmse_dx": 0.0545319989323616,
      "pose_rmse_dy": 0.11151859164237976,
      "pose_rmse_mean": 0.1210910975933075,
      "rmse_dtheta": 0.024207819253206253,
      "rmse_dx": 0.006287325639277697,
      "rmse_dy": 0.007585354149341583,
      "rmse_mean": 0.012693500146269798,
      "rotation_flip": 0.004302925895899534,
      "sparse_tokens": 32057.0,
      "step": 6773,
      "turn_loss": 0.07474219053983688,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.31471845381899277,
      "grad_norm": 0.4229239821434021,
      "learning_rate": 4.062833668582994e-06,
      "loss": 0.0664,
      "mae_dtheta": 0.0068025775253772736,
      "mae_dx": 0.0013021271442994475,
      "mae_dy": 0.00026118700043298304,
      "pose_mae_dtheta": 0.050607502460479736,
      "pose_mae_dx": 0.010378880426287651,
      "pose_mae_dy": 0.003764091059565544,
      "pose_rmse_dtheta": 0.23846450448036194,
      "pose_rmse_dx": 0.02315436489880085,
      "pose_rmse_dy": 0.006651762407273054,
      "pose_rmse_mean": 0.08942355215549469,
      "rmse_dtheta": 0.027823224663734436,
      "rmse_dx": 0.003552584210410714,
      "rmse_dy": 0.0005415623891167343,
      "rmse_mean": 0.010639125481247902,
      "rotation_flip": 0.0023242300376296043,
      "sparse_tokens": 32217.0,
      "step": 6774,
      "turn_loss": 0.03902517631649971,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.31476491358483555,
      "grad_norm": 0.6487452387809753,
      "learning_rate": 4.061534915477533e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.03804613649845123,
      "mae_dx": 0.012415647506713867,
      "mae_dy": 0.0029978356324136257,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6487454771995544,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 140.918701171875,
      "model/head/act_norm_mean": 103.1713271722561,
      "model/head/act_norm_min": 71.56914520263672,
      "model/head/act_over_embed": 70.90030193795747,
      "model/head/grad_frac": 0.08199667930603027,
      "model/head/grad_norm": 0.05319497361779213,
      "model/head/grad_zero_frac": 0.0001738649298204109,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6955864138719512,
      "model/head/update_ratio": 0.0009075968991965055,
      "model/head/weight_delta": 9.299423217773438,
      "model/head/weight_delta_rel": 0.1631394326686859,
      "model/head/weight_norm": 58.61079406738281,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4215392768383026,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4215392768383026,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4215392768383026,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28968573755616966,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09588533639907837,
      "model/modality_embedder.encoders.pose/grad_norm": 0.062205176800489426,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0020096611697226763,
      "model/modality_embedder.encoders.pose/weight_delta": 2.995607376098633,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09787582606077194,
      "model/modality_embedder.encoders.pose/weight_norm": 30.953067779541016,
      "model/modality_embedder/grad_frac": 0.09588533639907837,
      "model/modality_embedder/grad_norm": 0.062205176800489426,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0020096611697226763,
      "model/modality_embedder/weight_delta": 2.995607376098633,
      "model/modality_embedder/weight_delta_rel": 0.09787582606077194,
      "model/modality_embedder/weight_norm": 30.953067779541016,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.82633972167969,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.99009751258227,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.170025825500488,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.799010247330559,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06068870797753334,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03937152400612831,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014115499798208475,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.424160957336426,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08833789080381393,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.892404556274414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 80.91875457763672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.787675728319783,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.726273536682129,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.34711346423028,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06298854947090149,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.040863536298274994,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013779280707240105,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.073301315307617,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10646156221628189,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.65578269958496,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 82.34461212158203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.364831349206348,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.92247200012207,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.43094957246708,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0662284642457962,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04296541586518288,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014032003236934543,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.315570831298828,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11133065819740295,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.619586944580078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 82.81622314453125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.225703518195896,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.939513206481934,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.70975834875643,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0720229223370552,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04672454297542572,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015646446263417602,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8356080055236816,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09690762311220169,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.86271858215332,
      "model/normalizer/grad_frac": 0.29088637232780457,
      "model/normalizer/grad_norm": 0.18871121108531952,
      "model/normalizer/grad_zero_frac": 0.00016662511916365474,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002403054852038622,
      "model/normalizer/weight_delta": 5.997869491577148,
      "model/normalizer/weight_delta_rel": 0.07724908739328384,
      "model/normalizer/weight_norm": 78.52971649169922,
      "pose_mae_dtheta": 0.30937057733535767,
      "pose_mae_dx": 0.10439684242010117,
      "pose_mae_dy": 0.037282101809978485,
      "pose_rmse_dtheta": 0.5105747580528259,
      "pose_rmse_dx": 0.2263461798429489,
      "pose_rmse_dy": 0.1026296615600586,
      "pose_rmse_mean": 0.27985021471977234,
      "rmse_dtheta": 0.055298835039138794,
      "rmse_dx": 0.024945197626948357,
      "rmse_dy": 0.006981406360864639,
      "rmse_mean": 0.029075145721435547,
      "rotation_flip": 0.0141287287697196,
      "sparse_tokens": 22955.0,
      "step": 6775,
      "turn_loss": 0.250412255525589,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.3148113733506783,
      "grad_norm": 0.6366622447967529,
      "learning_rate": 4.060236227999441e-06,
      "loss": 0.1518,
      "mae_dtheta": 0.024240313097834587,
      "mae_dx": 0.008525715209543705,
      "mae_dy": 0.0018721313681453466,
      "pose_mae_dtheta": 0.18237045407295227,
      "pose_mae_dx": 0.06272196769714355,
      "pose_mae_dy": 0.016928570345044136,
      "pose_rmse_dtheta": 0.36864539980888367,
      "pose_rmse_dx": 0.19339920580387115,
      "pose_rmse_dy": 0.03320444002747536,
      "pose_rmse_mean": 0.1984163522720337,
      "rmse_dtheta": 0.04214233160018921,
      "rmse_dx": 0.021479977294802666,
      "rmse_dy": 0.003970850724726915,
      "rmse_mean": 0.02253105491399765,
      "rotation_flip": 0.0,
      "sparse_tokens": 8028.0,
      "step": 6776,
      "turn_loss": 0.15396948158740997,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3148578331165211,
      "grad_norm": 0.3903099000453949,
      "learning_rate": 4.058937606239535e-06,
      "loss": 0.0781,
      "mae_dtheta": 0.010251162573695183,
      "mae_dx": 0.0014867412392050028,
      "mae_dy": 0.001629821490496397,
      "pose_mae_dtheta": 0.07393979281187057,
      "pose_mae_dx": 0.01838604174554348,
      "pose_mae_dy": 0.024142835289239883,
      "pose_rmse_dtheta": 0.20937320590019226,
      "pose_rmse_dx": 0.0537477508187294,
      "pose_rmse_dy": 0.06855596601963043,
      "pose_rmse_mean": 0.11055897176265717,
      "rmse_dtheta": 0.02506689727306366,
      "rmse_dx": 0.004784592892974615,
      "rmse_dy": 0.004260160960257053,
      "rmse_mean": 0.011370550841093063,
      "rotation_flip": 0.004058853257447481,
      "sparse_tokens": 32089.0,
      "step": 6777,
      "turn_loss": 0.06584273278713226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.3149042928823639,
      "grad_norm": 0.7794593572616577,
      "learning_rate": 4.057639050288625e-06,
      "loss": 0.0715,
      "mae_dtheta": 0.02678566239774227,
      "mae_dx": 0.00823813397437334,
      "mae_dy": 0.0051517304964363575,
      "pose_mae_dtheta": 0.21543952822685242,
      "pose_mae_dx": 0.06492868065834045,
      "pose_mae_dy": 0.06780384480953217,
      "pose_rmse_dtheta": 0.41335809230804443,
      "pose_rmse_dx": 0.14528945088386536,
      "pose_rmse_dy": 0.20812451839447021,
      "pose_rmse_mean": 0.25559067726135254,
      "rmse_dtheta": 0.043317317962646484,
      "rmse_dx": 0.0190615002065897,
      "rmse_dy": 0.011695544235408306,
      "rmse_mean": 0.024691453203558922,
      "rotation_flip": 0.003759398590773344,
      "sparse_tokens": 10078.0,
      "step": 6778,
      "turn_loss": 0.2373499870300293,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.31495075264820666,
      "grad_norm": 0.6670752763748169,
      "learning_rate": 4.056340560237523e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.018830498680472374,
      "mae_dx": 0.01083772536367178,
      "mae_dy": 0.0029816029127687216,
      "pose_mae_dtheta": 0.13239561021327972,
      "pose_mae_dx": 0.09464918822050095,
      "pose_mae_dy": 0.03371965512633324,
      "pose_rmse_dtheta": 0.27516356110572815,
      "pose_rmse_dx": 0.27125152945518494,
      "pose_rmse_dy": 0.06470609456300735,
      "pose_rmse_mean": 0.20370706915855408,
      "rmse_dtheta": 0.0307543333619833,
      "rmse_dx": 0.025417685508728027,
      "rmse_dy": 0.005612815730273724,
      "rmse_mean": 0.020594947040081024,
      "rotation_flip": 0.0059523810632526875,
      "sparse_tokens": 3222.0,
      "step": 6779,
      "turn_loss": 0.10537294298410416,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.31499721241404943,
      "grad_norm": 0.5365948677062988,
      "learning_rate": 4.05504213617703e-06,
      "loss": 0.2088,
      "mae_dtheta": 0.014332862570881844,
      "mae_dx": 0.0026126003358513117,
      "mae_dy": 0.002725254977121949,
      "pose_mae_dtheta": 0.09200580418109894,
      "pose_mae_dx": 0.03306438401341438,
      "pose_mae_dy": 0.03120473399758339,
      "pose_rmse_dtheta": 0.18966972827911377,
      "pose_rmse_dx": 0.08215121179819107,
      "pose_rmse_dy": 0.06909813731908798,
      "pose_rmse_mean": 0.113639697432518,
      "rmse_dtheta": 0.026418445631861687,
      "rmse_dx": 0.006981267128139734,
      "rmse_dy": 0.005647295620292425,
      "rmse_mean": 0.013015668839216232,
      "rotation_flip": 0.005426917690783739,
      "sparse_tokens": 32089.0,
      "step": 6780,
      "turn_loss": 0.12692445516586304,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.3150436721798922,
      "grad_norm": 0.3564140200614929,
      "learning_rate": 4.053743778197951e-06,
      "loss": 0.0805,
      "mae_dtheta": 0.030061941593885422,
      "mae_dx": 0.011690136976540089,
      "mae_dy": 0.00497945211827755,
      "pose_mae_dtheta": 0.21431419253349304,
      "pose_mae_dx": 0.0972532257437706,
      "pose_mae_dy": 0.05021842196583748,
      "pose_rmse_dtheta": 0.3906477987766266,
      "pose_rmse_dx": 0.23826658725738525,
      "pose_rmse_dy": 0.11542654782533646,
      "pose_rmse_mean": 0.24811363220214844,
      "rmse_dtheta": 0.04693027213215828,
      "rmse_dx": 0.024646909907460213,
      "rmse_dy": 0.009788178838789463,
      "rmse_mean": 0.027121787890791893,
      "rotation_flip": 0.007968127727508545,
      "sparse_tokens": 13303.0,
      "step": 6781,
      "turn_loss": 0.2301376461982727,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.315090131945735,
      "grad_norm": 0.5530559420585632,
      "learning_rate": 4.052445486391075e-06,
      "loss": 0.1171,
      "mae_dtheta": 0.052883245050907135,
      "mae_dx": 0.013759837485849857,
      "mae_dy": 0.008763374760746956,
      "pose_mae_dtheta": 0.4411602318286896,
      "pose_mae_dx": 0.06056790053844452,
      "pose_mae_dy": 0.06275103241205215,
      "pose_rmse_dtheta": 0.7269163131713867,
      "pose_rmse_dx": 0.14273585379123688,
      "pose_rmse_dy": 0.15570314228534698,
      "pose_rmse_mean": 0.34178513288497925,
      "rmse_dtheta": 0.0762743204832077,
      "rmse_dx": 0.027047844603657722,
      "rmse_dy": 0.018160464242100716,
      "rmse_mean": 0.04049421101808548,
      "rotation_flip": 0.010948904789984226,
      "sparse_tokens": 4780.0,
      "step": 6782,
      "turn_loss": 0.3851017653942108,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 29108.0,
      "epoch": 0.31513659171157776,
      "grad_norm": 0.627954363822937,
      "learning_rate": 4.051147260847194e-06,
      "loss": 0.1397,
      "mae_dtheta": 0.035567935556173325,
      "mae_dx": 0.011334391310811043,
      "mae_dy": 0.0079498877748847,
      "pose_mae_dtheta": 0.27791714668273926,
      "pose_mae_dx": 0.0955544039607048,
      "pose_mae_dy": 0.08979496359825134,
      "pose_rmse_dtheta": 0.4736398458480835,
      "pose_rmse_dx": 0.20192250609397888,
      "pose_rmse_dy": 0.18278086185455322,
      "pose_rmse_mean": 0.2861144244670868,
      "rmse_dtheta": 0.05246058851480484,
      "rmse_dx": 0.02225041203200817,
      "rmse_dy": 0.014406914822757244,
      "rmse_mean": 0.029705971479415894,
      "rotation_flip": 0.018465908244252205,
      "sparse_tokens": 23880.0,
      "step": 6783,
      "turn_loss": 0.3213149309158325,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 11345.0,
      "epoch": 0.31518305147742054,
      "grad_norm": 1.1730002164840698,
      "learning_rate": 4.0498491016570975e-06,
      "loss": 0.2669,
      "mae_dtheta": 0.034798845648765564,
      "mae_dx": 0.00863692071288824,
      "mae_dy": 0.006530994549393654,
      "pose_mae_dtheta": 0.2632308602333069,
      "pose_mae_dx": 0.07213808596134186,
      "pose_mae_dy": 0.10717292875051498,
      "pose_rmse_dtheta": 0.49207693338394165,
      "pose_rmse_dx": 0.19668623805046082,
      "pose_rmse_dy": 0.232725590467453,
      "pose_rmse_mean": 0.30716294050216675,
      "rmse_dtheta": 0.05425345152616501,
      "rmse_dx": 0.021499723196029663,
      "rmse_dy": 0.011905678547918797,
      "rmse_mean": 0.029219618067145348,
      "rotation_flip": 0.0117647061124444,
      "sparse_tokens": 8682.0,
      "step": 6784,
      "turn_loss": 0.29671746492385864,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3152295112432633,
      "grad_norm": 0.7191523313522339,
      "learning_rate": 4.048551008911561e-06,
      "loss": 0.1611,
      "mae_dtheta": 0.010974873788654804,
      "mae_dx": 0.0012919666478410363,
      "mae_dy": 0.002087419619783759,
      "pose_mae_dtheta": 0.07539637386798859,
      "pose_mae_dx": 0.01966843567788601,
      "pose_mae_dy": 0.029838940128684044,
      "pose_rmse_dtheta": 0.22509318590164185,
      "pose_rmse_dx": 0.048483800143003464,
      "pose_rmse_dy": 0.08311866223812103,
      "pose_rmse_mean": 0.11889855563640594,
      "rmse_dtheta": 0.02670113556087017,
      "rmse_dx": 0.003939379006624222,
      "rmse_dy": 0.004873599391430616,
      "rmse_mean": 0.011838037520647049,
      "rotation_flip": 0.0066225165501236916,
      "sparse_tokens": 32121.0,
      "step": 6785,
      "turn_loss": 0.08342013508081436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3152759710091061,
      "grad_norm": 0.6686215996742249,
      "learning_rate": 4.047252982701364e-06,
      "loss": 0.0966,
      "mae_dtheta": 0.008495449088513851,
      "mae_dx": 0.0013150465674698353,
      "mae_dy": 0.0015900314319878817,
      "pose_mae_dtheta": 0.05647994577884674,
      "pose_mae_dx": 0.016592910513281822,
      "pose_mae_dy": 0.021361619234085083,
      "pose_rmse_dtheta": 0.16797976195812225,
      "pose_rmse_dx": 0.03769026696681976,
      "pose_rmse_dy": 0.04857610911130905,
      "pose_rmse_mean": 0.08474871516227722,
      "rmse_dtheta": 0.021890215575695038,
      "rmse_dx": 0.003684534691274166,
      "rmse_dy": 0.003643033094704151,
      "rmse_mean": 0.009739261120557785,
      "rotation_flip": 0.0031483666971325874,
      "sparse_tokens": 32137.0,
      "step": 6786,
      "turn_loss": 0.06707488000392914,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.31532243077494887,
      "grad_norm": 0.5991106629371643,
      "learning_rate": 4.045955023117276e-06,
      "loss": 0.134,
      "mae_dtheta": 0.0382751002907753,
      "mae_dx": 0.009386732243001461,
      "mae_dy": 0.00535072386264801,
      "pose_mae_dtheta": 0.3211430609226227,
      "pose_mae_dx": 0.07074940949678421,
      "pose_mae_dy": 0.0581415519118309,
      "pose_rmse_dtheta": 0.49443474411964417,
      "pose_rmse_dx": 0.15035656094551086,
      "pose_rmse_dy": 0.12193957716226578,
      "pose_rmse_mean": 0.2555769681930542,
      "rmse_dtheta": 0.051504187285900116,
      "rmse_dx": 0.019846197217702866,
      "rmse_dy": 0.009540467523038387,
      "rmse_mean": 0.026963617652654648,
      "rotation_flip": 0.002994012087583542,
      "sparse_tokens": 5692.0,
      "step": 6787,
      "turn_loss": 0.277236670255661,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 22395.0,
      "epoch": 0.3153688905407917,
      "grad_norm": 0.5236679911613464,
      "learning_rate": 4.044657130250066e-06,
      "loss": 0.1515,
      "mae_dtheta": 0.033335085958242416,
      "mae_dx": 0.008203644305467606,
      "mae_dy": 0.0035405103117227554,
      "pose_mae_dtheta": 0.25231286883354187,
      "pose_mae_dx": 0.061736099421978,
      "pose_mae_dy": 0.04086403176188469,
      "pose_rmse_dtheta": 0.4743029475212097,
      "pose_rmse_dx": 0.1755189448595047,
      "pose_rmse_dy": 0.1112353503704071,
      "pose_rmse_mean": 0.25368577241897583,
      "rmse_dtheta": 0.0527770109474659,
      "rmse_dx": 0.02012690156698227,
      "rmse_dy": 0.008098119869828224,
      "rmse_mean": 0.027000678703188896,
      "rotation_flip": 0.015711644664406776,
      "sparse_tokens": 18493.0,
      "step": 6788,
      "turn_loss": 0.2630935609340668,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3154153503066345,
      "grad_norm": 1.2140403985977173,
      "learning_rate": 4.043359304190497e-06,
      "loss": 0.1652,
      "mae_dtheta": 0.010497999377548695,
      "mae_dx": 0.0022877913434058428,
      "mae_dy": 0.0021685685496777296,
      "pose_mae_dtheta": 0.07666413486003876,
      "pose_mae_dx": 0.029406137764453888,
      "pose_mae_dy": 0.033397212624549866,
      "pose_rmse_dtheta": 0.1726837158203125,
      "pose_rmse_dx": 0.07919036597013474,
      "pose_rmse_dy": 0.07926966995000839,
      "pose_rmse_mean": 0.11038126051425934,
      "rmse_dtheta": 0.022688092663884163,
      "rmse_dx": 0.007050740532577038,
      "rmse_dy": 0.004817283246666193,
      "rmse_mean": 0.011518705636262894,
      "rotation_flip": 0.0026726056821644306,
      "sparse_tokens": 32057.0,
      "step": 6789,
      "turn_loss": 0.10597985982894897,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21747.0,
      "epoch": 0.31546181007247726,
      "grad_norm": 0.695381224155426,
      "learning_rate": 4.042061545029323e-06,
      "loss": 0.1687,
      "mae_dtheta": 0.028254196047782898,
      "mae_dx": 0.01354676391929388,
      "mae_dy": 0.004938285797834396,
      "pose_mae_dtheta": 0.21359378099441528,
      "pose_mae_dx": 0.10914786159992218,
      "pose_mae_dy": 0.0598108284175396,
      "pose_rmse_dtheta": 0.4096953868865967,
      "pose_rmse_dx": 0.2358141392469406,
      "pose_rmse_dy": 0.15970182418823242,
      "pose_rmse_mean": 0.2684037983417511,
      "rmse_dtheta": 0.04596562311053276,
      "rmse_dx": 0.026613494381308556,
      "rmse_dy": 0.010607392527163029,
      "rmse_mean": 0.027728836983442307,
      "rotation_flip": 0.006856023333966732,
      "sparse_tokens": 16983.0,
      "step": 6790,
      "turn_loss": 0.26088234782218933,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.31550826983832003,
      "grad_norm": 0.7598593831062317,
      "learning_rate": 4.0407638528573025e-06,
      "loss": 0.1453,
      "mae_dtheta": 0.010026953183114529,
      "mae_dx": 0.00197833520360291,
      "mae_dy": 0.001855396549217403,
      "pose_mae_dtheta": 0.07457558065652847,
      "pose_mae_dx": 0.02440452389419079,
      "pose_mae_dy": 0.023423124104738235,
      "pose_rmse_dtheta": 0.20387227833271027,
      "pose_rmse_dx": 0.06853070855140686,
      "pose_rmse_dy": 0.05984191596508026,
      "pose_rmse_mean": 0.11074831336736679,
      "rmse_dtheta": 0.02297677844762802,
      "rmse_dx": 0.006248833145946264,
      "rmse_dy": 0.004078952595591545,
      "rmse_mean": 0.01110152155160904,
      "rotation_flip": 0.002284148009493947,
      "sparse_tokens": 32073.0,
      "step": 6791,
      "turn_loss": 0.07972031086683273,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3155547296041628,
      "grad_norm": 0.4896700978279114,
      "learning_rate": 4.039466227765178e-06,
      "loss": 0.073,
      "mae_dtheta": 0.008184550330042839,
      "mae_dx": 0.0015157060697674751,
      "mae_dy": 0.0003322336997371167,
      "pose_mae_dtheta": 0.06221679225564003,
      "pose_mae_dx": 0.011755366809666157,
      "pose_mae_dy": 0.004636168945580721,
      "pose_rmse_dtheta": 0.2575283944606781,
      "pose_rmse_dx": 0.028751714155077934,
      "pose_rmse_dy": 0.010162526741623878,
      "pose_rmse_mean": 0.0988142117857933,
      "rmse_dtheta": 0.029654044657945633,
      "rmse_dx": 0.004476173780858517,
      "rmse_dy": 0.0007868485990911722,
      "rmse_mean": 0.011639023199677467,
      "rotation_flip": 0.0006468305364251137,
      "sparse_tokens": 32201.0,
      "step": 6792,
      "turn_loss": 0.041776157915592194,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.3156011893700056,
      "grad_norm": 0.6896751523017883,
      "learning_rate": 4.038168669843698e-06,
      "loss": 0.1334,
      "mae_dtheta": 0.037047646939754486,
      "mae_dx": 0.010032307356595993,
      "mae_dy": 0.00759129598736763,
      "pose_mae_dtheta": 0.3023240268230438,
      "pose_mae_dx": 0.08685362339019775,
      "pose_mae_dy": 0.07780839502811432,
      "pose_rmse_dtheta": 0.49555984139442444,
      "pose_rmse_dx": 0.1646355390548706,
      "pose_rmse_dy": 0.18132944405078888,
      "pose_rmse_mean": 0.28050827980041504,
      "rmse_dtheta": 0.050087377429008484,
      "rmse_dx": 0.01777154579758644,
      "rmse_dy": 0.016720395535230637,
      "rmse_mean": 0.02819310687482357,
      "rotation_flip": 0.018018018454313278,
      "sparse_tokens": 5256.0,
      "step": 6793,
      "turn_loss": 0.2911146283149719,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.31564764913584836,
      "grad_norm": 0.4695472717285156,
      "learning_rate": 4.036871179183596e-06,
      "loss": 0.1164,
      "mae_dtheta": 0.008666847832500935,
      "mae_dx": 0.0013413310516625643,
      "mae_dy": 0.0018429209012538195,
      "pose_mae_dtheta": 0.054989010095596313,
      "pose_mae_dx": 0.01714448258280754,
      "pose_mae_dy": 0.02731429971754551,
      "pose_rmse_dtheta": 0.10189134627580643,
      "pose_rmse_dx": 0.04311591386795044,
      "pose_rmse_dy": 0.05722733587026596,
      "pose_rmse_mean": 0.06741153448820114,
      "rmse_dtheta": 0.016719985753297806,
      "rmse_dx": 0.004484137054532766,
      "rmse_dy": 0.0038169240579009056,
      "rmse_mean": 0.008340349420905113,
      "rotation_flip": 0.007863695733249187,
      "sparse_tokens": 32057.0,
      "step": 6794,
      "turn_loss": 0.06257171183824539,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.31569410890169114,
      "grad_norm": 0.4330247938632965,
      "learning_rate": 4.035573755875611e-06,
      "loss": 0.081,
      "mae_dtheta": 0.009223217144608498,
      "mae_dx": 0.0014279860770329833,
      "mae_dy": 0.002142990007996559,
      "pose_mae_dtheta": 0.06285596638917923,
      "pose_mae_dx": 0.017256708815693855,
      "pose_mae_dy": 0.025112278759479523,
      "pose_rmse_dtheta": 0.16922903060913086,
      "pose_rmse_dx": 0.042172227054834366,
      "pose_rmse_dy": 0.08116714656352997,
      "pose_rmse_mean": 0.0975227952003479,
      "rmse_dtheta": 0.022070620208978653,
      "rmse_dx": 0.0037002582103013992,
      "rmse_dy": 0.004809649661183357,
      "rmse_mean": 0.010193509981036186,
      "rotation_flip": 0.0014695076970383525,
      "sparse_tokens": 32169.0,
      "step": 6795,
      "turn_loss": 0.0654473602771759,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3157405686675339,
      "grad_norm": 0.5792325139045715,
      "learning_rate": 4.0342764000104715e-06,
      "loss": 0.0938,
      "mae_dtheta": 0.01175639033317566,
      "mae_dx": 0.0019741966389119625,
      "mae_dy": 0.002359406091272831,
      "pose_mae_dtheta": 0.08657172322273254,
      "pose_mae_dx": 0.025767259299755096,
      "pose_mae_dy": 0.03275257349014282,
      "pose_rmse_dtheta": 0.22310641407966614,
      "pose_rmse_dx": 0.07225149869918823,
      "pose_rmse_dy": 0.08909124881029129,
      "pose_rmse_mean": 0.12814971804618835,
      "rmse_dtheta": 0.026363147422671318,
      "rmse_dx": 0.006909546442329884,
      "rmse_dy": 0.0054458570666611195,
      "rmse_mean": 0.012906184419989586,
      "rotation_flip": 0.005268199369311333,
      "sparse_tokens": 32057.0,
      "step": 6796,
      "turn_loss": 0.09588554501533508,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.3157870284333767,
      "grad_norm": 1.9057378768920898,
      "learning_rate": 4.032979111678901e-06,
      "loss": 0.2302,
      "mae_dtheta": 0.030809950083494186,
      "mae_dx": 0.01190502755343914,
      "mae_dy": 0.004371205344796181,
      "pose_mae_dtheta": 0.2575698792934418,
      "pose_mae_dx": 0.08427184075117111,
      "pose_mae_dy": 0.03252079337835312,
      "pose_rmse_dtheta": 0.5240718126296997,
      "pose_rmse_dx": 0.1872655600309372,
      "pose_rmse_dy": 0.07210089266300201,
      "pose_rmse_mean": 0.26114609837532043,
      "rmse_dtheta": 0.05120360851287842,
      "rmse_dx": 0.0246373750269413,
      "rmse_dy": 0.008972073905169964,
      "rmse_mean": 0.028271017596125603,
      "rotation_flip": 0.006472492124885321,
      "sparse_tokens": 5106.0,
      "step": 6797,
      "turn_loss": 0.21087202429771423,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.31583348819921947,
      "grad_norm": 0.4755658507347107,
      "learning_rate": 4.031681890971621e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.009995211847126484,
      "mae_dx": 0.0015737167559564114,
      "mae_dy": 0.0022108263801783323,
      "pose_mae_dtheta": 0.06548307090997696,
      "pose_mae_dx": 0.020478086546063423,
      "pose_mae_dy": 0.02670329064130783,
      "pose_rmse_dtheta": 0.1766202598810196,
      "pose_rmse_dx": 0.05046548694372177,
      "pose_rmse_dy": 0.0801873579621315,
      "pose_rmse_mean": 0.10242436826229095,
      "rmse_dtheta": 0.023139242082834244,
      "rmse_dx": 0.004443379584699869,
      "rmse_dy": 0.005498354788869619,
      "rmse_mean": 0.011026992462575436,
      "rotation_flip": 0.010192525573074818,
      "sparse_tokens": 32105.0,
      "step": 6798,
      "turn_loss": 0.09131874889135361,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.31587994796506225,
      "grad_norm": 1.1781044006347656,
      "learning_rate": 4.030384737979345e-06,
      "loss": 0.2467,
      "mae_dtheta": 0.027853786945343018,
      "mae_dx": 0.012676984071731567,
      "mae_dy": 0.004403416067361832,
      "pose_mae_dtheta": 0.22234009206295013,
      "pose_mae_dx": 0.11334311962127686,
      "pose_mae_dy": 0.049573011696338654,
      "pose_rmse_dtheta": 0.3641059398651123,
      "pose_rmse_dx": 0.20996949076652527,
      "pose_rmse_dy": 0.11741763353347778,
      "pose_rmse_mean": 0.23049770295619965,
      "rmse_dtheta": 0.04412063956260681,
      "rmse_dx": 0.02369534969329834,
      "rmse_dy": 0.008883990347385406,
      "rmse_mean": 0.02556665986776352,
      "rotation_flip": 0.010548523627221584,
      "sparse_tokens": 14862.0,
      "step": 6799,
      "turn_loss": 0.24341952800750732,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.315926407730905,
      "grad_norm": 1.1325002908706665,
      "learning_rate": 4.029087652792786e-06,
      "loss": 0.2703,
      "mae_dtheta": 0.02718498930335045,
      "mae_dx": 0.009623240679502487,
      "mae_dy": 0.003236764809116721,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999991059303284,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.76295471191406,
      "model/head/act_norm_mean": 116.73668981481481,
      "model/head/act_norm_min": 75.93357849121094,
      "model/head/act_over_embed": 80.2225461468498,
      "model/head/grad_frac": 0.11476527154445648,
      "model/head/grad_norm": 0.11476516723632812,
      "model/head/grad_zero_frac": 0.0001767203793860972,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6873010706018519,
      "model/head/update_ratio": 0.0019580151420086622,
      "model/head/weight_delta": 9.308626174926758,
      "model/head/weight_delta_rel": 0.16330087184906006,
      "model/head/weight_norm": 58.61301040649414,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4215605556964874,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4215173547918146,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42145124077796936,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28967067252058565,
      "model/modality_embedder.encoders.pose/grad_frac": 0.136665478348732,
      "model/modality_embedder.encoders.pose/grad_norm": 0.13666535913944244,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5095170454545455,
      "model/modality_embedder.encoders.pose/update_ratio": 0.004415183328092098,
      "model/modality_embedder.encoders.pose/weight_delta": 2.9985451698303223,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09797181934118271,
      "model/modality_embedder.encoders.pose/weight_norm": 30.9534969329834,
      "model/modality_embedder/grad_frac": 0.136665478348732,
      "model/modality_embedder/grad_norm": 0.13666535913944244,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5095170454545455,
      "model/modality_embedder/update_ratio": 0.004415183328092098,
      "model/modality_embedder/weight_delta": 2.9985451698303223,
      "model/modality_embedder/weight_delta_rel": 0.09797181934118271,
      "model/modality_embedder/weight_norm": 30.9534969329834,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.31416320800781,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.291335978835978,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.320272445678711,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.693233503726564,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0750378742814064,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.07503780722618103,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002690174849703908,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.428021192550659,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08847855776548386,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.893281936645508,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.53337860107422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.13594025573192,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.742193222045898,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.273653470119278,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07770539075136185,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07770532369613647,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0026201375294476748,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.0780670642852783,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10662665218114853,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.656963348388672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.06587982177734,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.771687610229275,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.205727577209473,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.39775436623787,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07270451635122299,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07270444929599762,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002374307718127966,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.3208870887756348,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11150917410850525,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.62132453918457,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.31884002685547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.59588109935332,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.899744033813477,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.651357210332435,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06830397248268127,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0683039128780365,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002287202514708042,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8403525352478027,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09706977009773254,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.86351776123047,
      "model/normalizer/grad_frac": 0.2518313229084015,
      "model/normalizer/grad_norm": 0.2518310844898224,
      "model/normalizer/grad_zero_frac": 0.00022098507906775922,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003206763882189989,
      "model/normalizer/weight_delta": 6.007473468780518,
      "model/normalizer/weight_delta_rel": 0.07737278193235397,
      "model/normalizer/weight_norm": 78.53121948242188,
      "pose_mae_dtheta": 0.20962394773960114,
      "pose_mae_dx": 0.07310787588357925,
      "pose_mae_dy": 0.046303585171699524,
      "pose_rmse_dtheta": 0.37359169125556946,
      "pose_rmse_dx": 0.19409842789173126,
      "pose_rmse_dy": 0.12329273670911789,
      "pose_rmse_mean": 0.23032763600349426,
      "rmse_dtheta": 0.04412856698036194,
      "rmse_dx": 0.02233046479523182,
      "rmse_dy": 0.006755100563168526,
      "rmse_mean": 0.02440471015870571,
      "rotation_flip": 0.009873060509562492,
      "sparse_tokens": 13649.0,
      "step": 6800,
      "turn_loss": 0.20865577459335327,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "epoch": 0.315926407730905,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30826878547668457,
      "eval_objectnav_nopose_mae_dtheta": 0.040613655000925064,
      "eval_objectnav_nopose_mae_dx": 0.012850332073867321,
      "eval_objectnav_nopose_mae_dy": 0.00484340637922287,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32435256242752075,
      "eval_objectnav_nopose_pose_mae_dx": 0.10353914648294449,
      "eval_objectnav_nopose_pose_mae_dy": 0.05446843057870865,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5452394485473633,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22741276025772095,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1274387538433075,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30003032088279724,
      "eval_objectnav_nopose_rmse_dtheta": 0.05827256292104721,
      "eval_objectnav_nopose_rmse_dx": 0.025452299043536186,
      "eval_objectnav_nopose_rmse_dy": 0.009920804761350155,
      "eval_objectnav_nopose_rmse_mean": 0.031215224415063858,
      "eval_objectnav_nopose_rotation_flip": 0.015238961204886436,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30826878547668457,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 6800
    },
    {
      "epoch": 0.315926407730905,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2783958911895752,
      "eval_objectnav_pose_mae_dtheta": 0.035618171095848083,
      "eval_objectnav_pose_mae_dx": 0.01124876644462347,
      "eval_objectnav_pose_mae_dy": 0.004557054024189711,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27186352014541626,
      "eval_objectnav_pose_pose_mae_dx": 0.08975344151258469,
      "eval_objectnav_pose_pose_mae_dy": 0.04825001582503319,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.47549429535865784,
      "eval_objectnav_pose_pose_rmse_dx": 0.20471608638763428,
      "eval_objectnav_pose_pose_rmse_dy": 0.11731819063425064,
      "eval_objectnav_pose_pose_rmse_mean": 0.26584285497665405,
      "eval_objectnav_pose_rmse_dtheta": 0.0533272810280323,
      "eval_objectnav_pose_rmse_dx": 0.023303113877773285,
      "eval_objectnav_pose_rmse_dy": 0.009589348919689655,
      "eval_objectnav_pose_rmse_mean": 0.028739918023347855,
      "eval_objectnav_pose_rotation_flip": 0.014548268169164658,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2783958911895752,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 6800
    },
    {
      "epoch": 0.315926407730905,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09221935272216797,
      "eval_pointnav_mae_dtheta": 0.010828753001987934,
      "eval_pointnav_mae_dx": 0.002426781691610813,
      "eval_pointnav_mae_dy": 0.0024359477683901787,
      "eval_pointnav_pose_mae_dtheta": 0.07533648610115051,
      "eval_pointnav_pose_mae_dx": 0.026629751548171043,
      "eval_pointnav_pose_mae_dy": 0.027142275124788284,
      "eval_pointnav_pose_rmse_dtheta": 0.20897354185581207,
      "eval_pointnav_pose_rmse_dx": 0.0801151767373085,
      "eval_pointnav_pose_rmse_dy": 0.07882782816886902,
      "eval_pointnav_pose_rmse_mean": 0.12263885140419006,
      "eval_pointnav_rmse_dtheta": 0.026082554832100868,
      "eval_pointnav_rmse_dx": 0.007706803735345602,
      "eval_pointnav_rmse_dy": 0.00654113432392478,
      "eval_pointnav_rmse_mean": 0.013443497940897942,
      "eval_pointnav_rotation_flip": 0.005496950354427099,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09221935272216797,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 6800
    },
    {
      "epoch": 0.315926407730905,
      "eval_loss": 0.22629467646280924,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30826878547668457,
      "eval_objectnav_nopose_mae_dtheta": 0.040613655000925064,
      "eval_objectnav_nopose_mae_dx": 0.012850332073867321,
      "eval_objectnav_nopose_mae_dy": 0.00484340637922287,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32435256242752075,
      "eval_objectnav_nopose_pose_mae_dx": 0.10353914648294449,
      "eval_objectnav_nopose_pose_mae_dy": 0.05446843057870865,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5452394485473633,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22741276025772095,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1274387538433075,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30003032088279724,
      "eval_objectnav_nopose_rmse_dtheta": 0.05827256292104721,
      "eval_objectnav_nopose_rmse_dx": 0.025452299043536186,
      "eval_objectnav_nopose_rmse_dy": 0.009920804761350155,
      "eval_objectnav_nopose_rmse_mean": 0.031215224415063858,
      "eval_objectnav_nopose_rotation_flip": 0.015238961204886436,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30826878547668457,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2783958911895752,
      "eval_objectnav_pose_mae_dtheta": 0.035618171095848083,
      "eval_objectnav_pose_mae_dx": 0.01124876644462347,
      "eval_objectnav_pose_mae_dy": 0.004557054024189711,
      "eval_objectnav_pose_pose_mae_dtheta": 0.27186352014541626,
      "eval_objectnav_pose_pose_mae_dx": 0.08975344151258469,
      "eval_objectnav_pose_pose_mae_dy": 0.04825001582503319,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.47549429535865784,
      "eval_objectnav_pose_pose_rmse_dx": 0.20471608638763428,
      "eval_objectnav_pose_pose_rmse_dy": 0.11731819063425064,
      "eval_objectnav_pose_pose_rmse_mean": 0.26584285497665405,
      "eval_objectnav_pose_rmse_dtheta": 0.0533272810280323,
      "eval_objectnav_pose_rmse_dx": 0.023303113877773285,
      "eval_objectnav_pose_rmse_dy": 0.009589348919689655,
      "eval_objectnav_pose_rmse_mean": 0.028739918023347855,
      "eval_objectnav_pose_rotation_flip": 0.014548268169164658,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2783958911895752,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09221935272216797,
      "eval_pointnav_mae_dtheta": 0.010828753001987934,
      "eval_pointnav_mae_dx": 0.002426781691610813,
      "eval_pointnav_mae_dy": 0.0024359477683901787,
      "eval_pointnav_pose_mae_dtheta": 0.07533648610115051,
      "eval_pointnav_pose_mae_dx": 0.026629751548171043,
      "eval_pointnav_pose_mae_dy": 0.027142275124788284,
      "eval_pointnav_pose_rmse_dtheta": 0.20897354185581207,
      "eval_pointnav_pose_rmse_dx": 0.0801151767373085,
      "eval_pointnav_pose_rmse_dy": 0.07882782816886902,
      "eval_pointnav_pose_rmse_mean": 0.12263885140419006,
      "eval_pointnav_rmse_dtheta": 0.026082554832100868,
      "eval_pointnav_rmse_dx": 0.007706803735345602,
      "eval_pointnav_rmse_dy": 0.00654113432392478,
      "eval_pointnav_rmse_mean": 0.013443497940897942,
      "eval_pointnav_rotation_flip": 0.005496950354427099,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09221935272216797,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 6800
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.3159728674967478,
      "grad_norm": 0.4763973355293274,
      "learning_rate": 4.027790635502646e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.030335938557982445,
      "mae_dx": 0.005007182713598013,
      "mae_dy": 0.0021238832268863916,
      "pose_mae_dtheta": 0.26357048749923706,
      "pose_mae_dx": 0.02847352623939514,
      "pose_mae_dy": 0.027219193056225777,
      "pose_rmse_dtheta": 0.5300028920173645,
      "pose_rmse_dx": 0.07080104947090149,
      "pose_rmse_dy": 0.107582688331604,
      "pose_rmse_mean": 0.23612889647483826,
      "rmse_dtheta": 0.054873839020729065,
      "rmse_dx": 0.012974540702998638,
      "rmse_dy": 0.005054149776697159,
      "rmse_mean": 0.024300843477249146,
      "rotation_flip": 0.01879699155688286,
      "sparse_tokens": 4975.0,
      "step": 6801,
      "turn_loss": 0.18691092729568481,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3160193272625906,
      "grad_norm": 0.5186339616775513,
      "learning_rate": 4.02649368619963e-06,
      "loss": 0.1236,
      "mae_dtheta": 0.007420915644615889,
      "mae_dx": 0.0010694395750761032,
      "mae_dy": 0.00021723251848015934,
      "pose_mae_dtheta": 0.05606313422322273,
      "pose_mae_dx": 0.0081141646951437,
      "pose_mae_dy": 0.0031520093325525522,
      "pose_rmse_dtheta": 0.26464158296585083,
      "pose_rmse_dx": 0.020032044500112534,
      "pose_rmse_dy": 0.005692599806934595,
      "pose_rmse_mean": 0.09678874909877777,
      "rmse_dtheta": 0.029485397040843964,
      "rmse_dx": 0.0031706516165286303,
      "rmse_dy": 0.0004566324641928077,
      "rmse_mean": 0.011037560179829597,
      "rotation_flip": 0.0,
      "sparse_tokens": 32153.0,
      "step": 6802,
      "turn_loss": 0.03336258605122566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6521.0,
      "epoch": 0.31606578702843335,
      "grad_norm": 0.5065597891807556,
      "learning_rate": 4.025196804974435e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.025086427107453346,
      "mae_dx": 0.009862961247563362,
      "mae_dy": 0.003222377970814705,
      "pose_mae_dtheta": 0.18774554133415222,
      "pose_mae_dx": 0.07176022976636887,
      "pose_mae_dy": 0.0381678007543087,
      "pose_rmse_dtheta": 0.31860819458961487,
      "pose_rmse_dx": 0.18466873466968536,
      "pose_rmse_dy": 0.08435562998056412,
      "pose_rmse_mean": 0.1958775371313095,
      "rmse_dtheta": 0.037203628569841385,
      "rmse_dx": 0.02250531129539013,
      "rmse_dy": 0.006423658691346645,
      "rmse_mean": 0.02204420045018196,
      "rotation_flip": 0.00958466436713934,
      "sparse_tokens": 4979.0,
      "step": 6803,
      "turn_loss": 0.26679903268814087,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.31611224679427613,
      "grad_norm": 0.6345939636230469,
      "learning_rate": 4.023899991917748e-06,
      "loss": 0.1676,
      "mae_dtheta": 0.010138462297618389,
      "mae_dx": 0.002020391868427396,
      "mae_dy": 0.0022028274834156036,
      "pose_mae_dtheta": 0.06586059927940369,
      "pose_mae_dx": 0.023844432085752487,
      "pose_mae_dy": 0.026384299620985985,
      "pose_rmse_dtheta": 0.1378607302904129,
      "pose_rmse_dx": 0.054963164031505585,
      "pose_rmse_dy": 0.06801687926054001,
      "pose_rmse_mean": 0.08694692701101303,
      "rmse_dtheta": 0.020383117720484734,
      "rmse_dx": 0.0053237187676131725,
      "rmse_dy": 0.00428490387275815,
      "rmse_mean": 0.009997246786952019,
      "rotation_flip": 0.00441276328638196,
      "sparse_tokens": 32169.0,
      "step": 6804,
      "turn_loss": 0.0926915779709816,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36663.0,
      "epoch": 0.31615870656011896,
      "grad_norm": 0.991021990776062,
      "learning_rate": 4.02260324712026e-06,
      "loss": 0.2411,
      "mae_dtheta": 0.02910182997584343,
      "mae_dx": 0.00680537847802043,
      "mae_dy": 0.003128037555143237,
      "pose_mae_dtheta": 0.22019323706626892,
      "pose_mae_dx": 0.04814888536930084,
      "pose_mae_dy": 0.040752340108156204,
      "pose_rmse_dtheta": 0.4532128870487213,
      "pose_rmse_dx": 0.12426445633172989,
      "pose_rmse_dy": 0.0978158563375473,
      "pose_rmse_mean": 0.22509774565696716,
      "rmse_dtheta": 0.04919959232211113,
      "rmse_dx": 0.01653214357793331,
      "rmse_dy": 0.006903388537466526,
      "rmse_mean": 0.024211708456277847,
      "rotation_flip": 0.008547008968889713,
      "sparse_tokens": 29053.0,
      "step": 6805,
      "turn_loss": 0.19022542238235474,
      "turns": 113.0,
      "turns_per_sample": 113.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.31620516632596174,
      "grad_norm": 0.6173353791236877,
      "learning_rate": 4.021306570672651e-06,
      "loss": 0.1159,
      "mae_dtheta": 0.0103810029104352,
      "mae_dx": 0.001833092188462615,
      "mae_dy": 0.0017841713270172477,
      "pose_mae_dtheta": 0.07164976000785828,
      "pose_mae_dx": 0.01984514109790325,
      "pose_mae_dy": 0.02217206172645092,
      "pose_rmse_dtheta": 0.2062675803899765,
      "pose_rmse_dx": 0.045598745346069336,
      "pose_rmse_dy": 0.052836306393146515,
      "pose_rmse_mean": 0.10156755149364471,
      "rmse_dtheta": 0.02425242029130459,
      "rmse_dx": 0.005437718704342842,
      "rmse_dy": 0.0037813931703567505,
      "rmse_mean": 0.01115717738866806,
      "rotation_flip": 0.005639097653329372,
      "sparse_tokens": 32153.0,
      "step": 6806,
      "turn_loss": 0.07488194108009338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3162516260918045,
      "grad_norm": 0.5563274025917053,
      "learning_rate": 4.020009962665598e-06,
      "loss": 0.139,
      "mae_dtheta": 0.009304693900048733,
      "mae_dx": 0.0015775199281051755,
      "mae_dy": 0.002603357657790184,
      "pose_mae_dtheta": 0.06845201551914215,
      "pose_mae_dx": 0.02052736096084118,
      "pose_mae_dy": 0.031109163537621498,
      "pose_rmse_dtheta": 0.16295665502548218,
      "pose_rmse_dx": 0.058940496295690536,
      "pose_rmse_dy": 0.09886708855628967,
      "pose_rmse_mean": 0.10692141950130463,
      "rmse_dtheta": 0.02022034488618374,
      "rmse_dx": 0.004534038249403238,
      "rmse_dy": 0.006863631308078766,
      "rmse_mean": 0.010539337992668152,
      "rotation_flip": 0.005508474539965391,
      "sparse_tokens": 32073.0,
      "step": 6807,
      "turn_loss": 0.08356259018182755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.3162980858576473,
      "grad_norm": 0.5847495198249817,
      "learning_rate": 4.0187134231897754e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.02770201489329338,
      "mae_dx": 0.008838378824293613,
      "mae_dy": 0.004117665812373161,
      "pose_mae_dtheta": 0.18336769938468933,
      "pose_mae_dx": 0.0802924633026123,
      "pose_mae_dy": 0.06215885281562805,
      "pose_rmse_dtheta": 0.35221779346466064,
      "pose_rmse_dx": 0.17796629667282104,
      "pose_rmse_dy": 0.1416255384683609,
      "pose_rmse_mean": 0.2239365428686142,
      "rmse_dtheta": 0.04605118930339813,
      "rmse_dx": 0.02029765397310257,
      "rmse_dy": 0.0076704262755811214,
      "rmse_mean": 0.024673089385032654,
      "rotation_flip": 0.011131725274026394,
      "sparse_tokens": 8639.0,
      "step": 6808,
      "turn_loss": 0.22704268991947174,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.31634454562349007,
      "grad_norm": 0.6346381306648254,
      "learning_rate": 4.017416952335849e-06,
      "loss": 0.1534,
      "mae_dtheta": 0.009571845643222332,
      "mae_dx": 0.002384468214586377,
      "mae_dy": 0.0014600957510992885,
      "pose_mae_dtheta": 0.05956054851412773,
      "pose_mae_dx": 0.022725136950612068,
      "pose_mae_dy": 0.014684570953249931,
      "pose_rmse_dtheta": 0.192127525806427,
      "pose_rmse_dx": 0.06127213314175606,
      "pose_rmse_dy": 0.03372623026371002,
      "pose_rmse_mean": 0.09570863097906113,
      "rmse_dtheta": 0.02578866109251976,
      "rmse_dx": 0.007656441070139408,
      "rmse_dy": 0.003366162534803152,
      "rmse_mean": 0.012270420789718628,
      "rotation_flip": 0.0038910505827516317,
      "sparse_tokens": 32105.0,
      "step": 6809,
      "turn_loss": 0.10414649546146393,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.31639100538933285,
      "grad_norm": 0.3819647431373596,
      "learning_rate": 4.0161205501944845e-06,
      "loss": 0.0774,
      "mae_dtheta": 0.03233897686004639,
      "mae_dx": 0.006807798519730568,
      "mae_dy": 0.0022020272444933653,
      "pose_mae_dtheta": 0.277028888463974,
      "pose_mae_dx": 0.05041544884443283,
      "pose_mae_dy": 0.020651109516620636,
      "pose_rmse_dtheta": 0.6263836622238159,
      "pose_rmse_dx": 0.15181118249893188,
      "pose_rmse_dy": 0.04647797718644142,
      "pose_rmse_mean": 0.2748909592628479,
      "rmse_dtheta": 0.05973220244050026,
      "rmse_dx": 0.017892953008413315,
      "rmse_dy": 0.0046914927661418915,
      "rmse_mean": 0.02743888460099697,
      "rotation_flip": 0.011111111380159855,
      "sparse_tokens": 4982.0,
      "step": 6810,
      "turn_loss": 0.1761428564786911,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3164374651551756,
      "grad_norm": 0.7286186814308167,
      "learning_rate": 4.014824216856336e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.00975858885794878,
      "mae_dx": 0.0019789293874055147,
      "mae_dy": 0.0027771464083343744,
      "pose_mae_dtheta": 0.06426714360713959,
      "pose_mae_dx": 0.02037760056555271,
      "pose_mae_dy": 0.027433395385742188,
      "pose_rmse_dtheta": 0.1405443549156189,
      "pose_rmse_dx": 0.05839615687727928,
      "pose_rmse_dy": 0.0618937686085701,
      "pose_rmse_mean": 0.08694475889205933,
      "rmse_dtheta": 0.02085563912987709,
      "rmse_dx": 0.006283201742917299,
      "rmse_dy": 0.007185093592852354,
      "rmse_mean": 0.011441311798989773,
      "rotation_flip": 0.006112469360232353,
      "sparse_tokens": 32105.0,
      "step": 6811,
      "turn_loss": 0.09322137385606766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3164839249210184,
      "grad_norm": 0.6557788252830505,
      "learning_rate": 4.01352795241206e-06,
      "loss": 0.1002,
      "mae_dtheta": 0.010059850290417671,
      "mae_dx": 0.0021970360539853573,
      "mae_dy": 0.0016598374349996448,
      "pose_mae_dtheta": 0.07849877327680588,
      "pose_mae_dx": 0.025955431163311005,
      "pose_mae_dy": 0.02457345277070999,
      "pose_rmse_dtheta": 0.2208198755979538,
      "pose_rmse_dx": 0.07958630472421646,
      "pose_rmse_dy": 0.06138663366436958,
      "pose_rmse_mean": 0.12059761583805084,
      "rmse_dtheta": 0.02320175990462303,
      "rmse_dx": 0.007583799306303263,
      "rmse_dy": 0.004164370242506266,
      "rmse_mean": 0.01164997648447752,
      "rotation_flip": 0.003626943100243807,
      "sparse_tokens": 32057.0,
      "step": 6812,
      "turn_loss": 0.07588519901037216,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.3165303846868612,
      "grad_norm": 0.8671014308929443,
      "learning_rate": 4.012231756952304e-06,
      "loss": 0.1565,
      "mae_dtheta": 0.03461100161075592,
      "mae_dx": 0.01144893653690815,
      "mae_dy": 0.00554386293515563,
      "pose_mae_dtheta": 0.27462249994277954,
      "pose_mae_dx": 0.09439694136381149,
      "pose_mae_dy": 0.06527606397867203,
      "pose_rmse_dtheta": 0.4669378101825714,
      "pose_rmse_dx": 0.20189158618450165,
      "pose_rmse_dy": 0.1487291157245636,
      "pose_rmse_mean": 0.2725195288658142,
      "rmse_dtheta": 0.052368927747011185,
      "rmse_dx": 0.02310800366103649,
      "rmse_dy": 0.012131926603615284,
      "rmse_mean": 0.029202952980995178,
      "rotation_flip": 0.013832383789122105,
      "sparse_tokens": 20096.0,
      "step": 6813,
      "turn_loss": 0.28910031914711,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.31657684445270395,
      "grad_norm": 0.508405327796936,
      "learning_rate": 4.0109356305677085e-06,
      "loss": 0.1347,
      "mae_dtheta": 0.008973352611064911,
      "mae_dx": 0.0016927310498431325,
      "mae_dy": 0.0017048318404704332,
      "pose_mae_dtheta": 0.0625840350985527,
      "pose_mae_dx": 0.021130481734871864,
      "pose_mae_dy": 0.021897798404097557,
      "pose_rmse_dtheta": 0.17499160766601562,
      "pose_rmse_dx": 0.0582408607006073,
      "pose_rmse_dy": 0.0522402748465538,
      "pose_rmse_mean": 0.09515758603811264,
      "rmse_dtheta": 0.021521184593439102,
      "rmse_dx": 0.005546702072024345,
      "rmse_dy": 0.0038049560971558094,
      "rmse_mean": 0.010290947742760181,
      "rotation_flip": 0.0017256255960091949,
      "sparse_tokens": 32105.0,
      "step": 6814,
      "turn_loss": 0.06142662465572357,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.31662330421854673,
      "grad_norm": 0.44292521476745605,
      "learning_rate": 4.009639573348919e-06,
      "loss": 0.1023,
      "mae_dtheta": 0.006920569576323032,
      "mae_dx": 0.0023149673361331224,
      "mae_dy": 0.002028452465310693,
      "pose_mae_dtheta": 0.043296825140714645,
      "pose_mae_dx": 0.023547127842903137,
      "pose_mae_dy": 0.02363463118672371,
      "pose_rmse_dtheta": 0.08264530450105667,
      "pose_rmse_dx": 0.050248321145772934,
      "pose_rmse_dy": 0.05199279636144638,
      "pose_rmse_mean": 0.061628811061382294,
      "rmse_dtheta": 0.0143423518165946,
      "rmse_dx": 0.006266359705477953,
      "rmse_dy": 0.004369080998003483,
      "rmse_mean": 0.008325930684804916,
      "rotation_flip": 0.003881987649947405,
      "sparse_tokens": 32137.0,
      "step": 6815,
      "turn_loss": 0.08722002059221268,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.3166697639843895,
      "grad_norm": 0.5879588723182678,
      "learning_rate": 4.008343585386562e-06,
      "loss": 0.1379,
      "mae_dtheta": 0.027899794280529022,
      "mae_dx": 0.009779875166714191,
      "mae_dy": 0.0052896467968821526,
      "pose_mae_dtheta": 0.19885952770709991,
      "pose_mae_dx": 0.07190480083227158,
      "pose_mae_dy": 0.0674552172422409,
      "pose_rmse_dtheta": 0.3411789536476135,
      "pose_rmse_dx": 0.16216221451759338,
      "pose_rmse_dy": 0.15710748732089996,
      "pose_rmse_mean": 0.22014956176280975,
      "rmse_dtheta": 0.04348473995923996,
      "rmse_dx": 0.021912328898906708,
      "rmse_dy": 0.010366756469011307,
      "rmse_mean": 0.02525460720062256,
      "rotation_flip": 0.015009380877017975,
      "sparse_tokens": 9302.0,
      "step": 6816,
      "turn_loss": 0.2651958167552948,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3167162237502323,
      "grad_norm": 0.6705706715583801,
      "learning_rate": 4.007047666771274e-06,
      "loss": 0.196,
      "mae_dtheta": 0.012647684663534164,
      "mae_dx": 0.00258909584954381,
      "mae_dy": 0.00376872974447906,
      "pose_mae_dtheta": 0.08658700436353683,
      "pose_mae_dx": 0.032558754086494446,
      "pose_mae_dy": 0.03551642596721649,
      "pose_rmse_dtheta": 0.19935005903244019,
      "pose_rmse_dx": 0.08910302072763443,
      "pose_rmse_dy": 0.0765070989727974,
      "pose_rmse_mean": 0.12165339291095734,
      "rmse_dtheta": 0.024664606899023056,
      "rmse_dx": 0.006383894011378288,
      "rmse_dy": 0.008109327405691147,
      "rmse_mean": 0.01305261068046093,
      "rotation_flip": 0.007028753869235516,
      "sparse_tokens": 32153.0,
      "step": 6817,
      "turn_loss": 0.12683254480361938,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.31676268351607506,
      "grad_norm": 0.6449783444404602,
      "learning_rate": 4.005751817593673e-06,
      "loss": 0.134,
      "mae_dtheta": 0.03164133056998253,
      "mae_dx": 0.015370659530162811,
      "mae_dy": 0.004997752606868744,
      "pose_mae_dtheta": 0.2169582098722458,
      "pose_mae_dx": 0.10685752332210541,
      "pose_mae_dy": 0.0848064124584198,
      "pose_rmse_dtheta": 0.3690570592880249,
      "pose_rmse_dx": 0.2583252489566803,
      "pose_rmse_dy": 0.15647463500499725,
      "pose_rmse_mean": 0.261285662651062,
      "rmse_dtheta": 0.048392198979854584,
      "rmse_dx": 0.03063918836414814,
      "rmse_dy": 0.00865837000310421,
      "rmse_mean": 0.029229920357465744,
      "rotation_flip": 0.012500000186264515,
      "sparse_tokens": 5740.0,
      "step": 6818,
      "turn_loss": 0.2168421447277069,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 27816.0,
      "epoch": 0.31680914328191784,
      "grad_norm": 0.619087278842926,
      "learning_rate": 4.004456037944383e-06,
      "loss": 0.2045,
      "mae_dtheta": 0.03020854853093624,
      "mae_dx": 0.014748318120837212,
      "mae_dy": 0.0060605150647461414,
      "pose_mae_dtheta": 0.24129287898540497,
      "pose_mae_dx": 0.11781866103410721,
      "pose_mae_dy": 0.07882792502641678,
      "pose_rmse_dtheta": 0.3956666886806488,
      "pose_rmse_dx": 0.26303547620773315,
      "pose_rmse_dy": 0.16891728341579437,
      "pose_rmse_mean": 0.2758731544017792,
      "rmse_dtheta": 0.04509611055254936,
      "rmse_dx": 0.028495866805315018,
      "rmse_dy": 0.01193595677614212,
      "rmse_mean": 0.028509311378002167,
      "rotation_flip": 0.017202692106366158,
      "sparse_tokens": 21530.0,
      "step": 6819,
      "turn_loss": 0.2986798882484436,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3168556030477606,
      "grad_norm": 0.485850065946579,
      "learning_rate": 4.003160327914015e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.010567517019808292,
      "mae_dx": 0.0013302711304277182,
      "mae_dy": 0.0024516689591109753,
      "pose_mae_dtheta": 0.06400049477815628,
      "pose_mae_dx": 0.019233956933021545,
      "pose_mae_dy": 0.028307855129241943,
      "pose_rmse_dtheta": 0.12447624653577805,
      "pose_rmse_dx": 0.04940252751111984,
      "pose_rmse_dy": 0.06476086378097534,
      "pose_rmse_mean": 0.07954654842615128,
      "rmse_dtheta": 0.01928681507706642,
      "rmse_dx": 0.004008523188531399,
      "rmse_dy": 0.0048692855052649975,
      "rmse_mean": 0.009388208389282227,
      "rotation_flip": 0.0071013555862009525,
      "sparse_tokens": 32105.0,
      "step": 6820,
      "turn_loss": 0.08473336696624756,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.31690206281360345,
      "grad_norm": 0.6199035048484802,
      "learning_rate": 4.00186468759318e-06,
      "loss": 0.0912,
      "mae_dtheta": 0.008300550282001495,
      "mae_dx": 0.0016219582175835967,
      "mae_dy": 0.0019393385155126452,
      "pose_mae_dtheta": 0.059549637138843536,
      "pose_mae_dx": 0.02488071098923683,
      "pose_mae_dy": 0.0231142770498991,
      "pose_rmse_dtheta": 0.17196118831634521,
      "pose_rmse_dx": 0.06891405582427979,
      "pose_rmse_dy": 0.05079026147723198,
      "pose_rmse_mean": 0.09722183644771576,
      "rmse_dtheta": 0.021831687539815903,
      "rmse_dx": 0.005397337023168802,
      "rmse_dy": 0.004406461026519537,
      "rmse_mean": 0.010545162484049797,
      "rotation_flip": 0.0013513513840734959,
      "sparse_tokens": 32089.0,
      "step": 6821,
      "turn_loss": 0.060098905116319656,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.3169485225794462,
      "grad_norm": 0.618926465511322,
      "learning_rate": 4.000569117072486e-06,
      "loss": 0.1414,
      "mae_dtheta": 0.046020302921533585,
      "mae_dx": 0.009451405145227909,
      "mae_dy": 0.00884709320962429,
      "pose_mae_dtheta": 0.34561869502067566,
      "pose_mae_dx": 0.08507069945335388,
      "pose_mae_dy": 0.09784083813428879,
      "pose_rmse_dtheta": 0.589220404624939,
      "pose_rmse_dx": 0.17570726573467255,
      "pose_rmse_dy": 0.2146940976381302,
      "pose_rmse_mean": 0.32654058933258057,
      "rmse_dtheta": 0.06471865624189377,
      "rmse_dx": 0.020622218027710915,
      "rmse_dy": 0.016476783901453018,
      "rmse_mean": 0.03393922001123428,
      "rotation_flip": 0.01275917049497366,
      "sparse_tokens": 18782.0,
      "step": 6822,
      "turn_loss": 0.3757151961326599,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.316994982345289,
      "grad_norm": 0.5798372626304626,
      "learning_rate": 3.999273616442526e-06,
      "loss": 0.1301,
      "mae_dtheta": 0.01199420914053917,
      "mae_dx": 0.0021789525635540485,
      "mae_dy": 0.0037936773151159286,
      "pose_mae_dtheta": 0.07459540665149689,
      "pose_mae_dx": 0.03324182704091072,
      "pose_mae_dy": 0.03988250717520714,
      "pose_rmse_dtheta": 0.1618068963289261,
      "pose_rmse_dx": 0.08239555358886719,
      "pose_rmse_dy": 0.10294055193662643,
      "pose_rmse_mean": 0.11571433395147324,
      "rmse_dtheta": 0.023462122306227684,
      "rmse_dx": 0.006858901586383581,
      "rmse_dy": 0.008323830552399158,
      "rmse_mean": 0.012881617993116379,
      "rotation_flip": 0.004006677772849798,
      "sparse_tokens": 32089.0,
      "step": 6823,
      "turn_loss": 0.1151978000998497,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3170414421111318,
      "grad_norm": 0.40452584624290466,
      "learning_rate": 3.9979781857939024e-06,
      "loss": 0.0911,
      "mae_dtheta": 0.012827622704207897,
      "mae_dx": 0.002297785598784685,
      "mae_dy": 0.002760510426014662,
      "pose_mae_dtheta": 0.08409054577350616,
      "pose_mae_dx": 0.03129027783870697,
      "pose_mae_dy": 0.03138086944818497,
      "pose_rmse_dtheta": 0.18612729012966156,
      "pose_rmse_dx": 0.07988442480564117,
      "pose_rmse_dy": 0.0726500079035759,
      "pose_rmse_mean": 0.11288724839687347,
      "rmse_dtheta": 0.02469763532280922,
      "rmse_dx": 0.006868637632578611,
      "rmse_dy": 0.0056785037741065025,
      "rmse_mean": 0.012414926663041115,
      "rotation_flip": 0.0050573162734508514,
      "sparse_tokens": 32121.0,
      "step": 6824,
      "turn_loss": 0.10818604379892349,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.31708790187697455,
      "grad_norm": 0.554152250289917,
      "learning_rate": 3.9966828252172005e-06,
      "loss": 0.1438,
      "mae_dtheta": 0.0387425571680069,
      "mae_dx": 0.007084695156663656,
      "mae_dy": 0.0031619856599718332,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5541524291038513,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 169.08160400390625,
      "model/head/act_norm_mean": 106.91629028320312,
      "model/head/act_norm_min": 68.90496826171875,
      "model/head/act_over_embed": 73.4738756486973,
      "model/head/grad_frac": 0.12575671076774597,
      "model/head/grad_norm": 0.06968838721513748,
      "model/head/grad_zero_frac": 0.0001675194944255054,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6776326497395834,
      "model/head/update_ratio": 0.0011889024171978235,
      "model/head/weight_delta": 9.319025039672852,
      "model/head/weight_delta_rel": 0.16348330676555634,
      "model/head/weight_norm": 58.6157341003418,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42158639430999756,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42152128414231904,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42147114872932434,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2896733728070395,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0839456245303154,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04651867225766182,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5496253188775511,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015028354246169329,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0030059814453125,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09811756759881973,
      "model/modality_embedder.encoders.pose/weight_norm": 30.953937530517578,
      "model/modality_embedder/grad_frac": 0.0839456245303154,
      "model/modality_embedder/grad_norm": 0.04651867225766182,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5496253188775511,
      "model/modality_embedder/update_ratio": 0.0015028354246169329,
      "model/modality_embedder/weight_delta": 3.0030059814453125,
      "model/modality_embedder/weight_delta_rel": 0.09811756759881973,
      "model/modality_embedder/weight_norm": 30.953937530517578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.90337371826172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.46785610945767,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.331282615661621,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.12733042794979,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08205243945121765,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.045469559729099274,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001630088547244668,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4320380687713623,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08862493187189102,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.8939208984375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.46656799316406,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.34752449156746,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.829971313476562,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.731846775720783,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07704012095928192,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04269196838140488,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014394787140190601,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.0827267169952393,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10678806155920029,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.657936096191406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.18091583251953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.11278263475529,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.21583366394043,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.944948698326577,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07772836089134216,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04307335987687111,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014065888244658709,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.3266408443450928,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11170236766338348,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.62256622314453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.81697845458984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.995321283895503,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.853643417358398,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.238646882620245,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07335082441568375,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.040647536516189575,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013610738096758723,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.84540057182312,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09724228829145432,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.864315032958984,
      "model/normalizer/grad_frac": 0.27569013833999634,
      "model/normalizer/grad_norm": 0.1527743637561798,
      "model/normalizer/grad_zero_frac": 0.0002079859550576657,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0019453676650300622,
      "model/normalizer/weight_delta": 6.017598628997803,
      "model/normalizer/weight_delta_rel": 0.07750318944454193,
      "model/normalizer/weight_norm": 78.53238677978516,
      "pose_mae_dtheta": 0.30360129475593567,
      "pose_mae_dx": 0.06030087172985077,
      "pose_mae_dy": 0.0308141577988863,
      "pose_rmse_dtheta": 0.5610073208808899,
      "pose_rmse_dx": 0.1473902314901352,
      "pose_rmse_dy": 0.0774792954325676,
      "pose_rmse_mean": 0.2619589567184448,
      "rmse_dtheta": 0.060757603496313095,
      "rmse_dx": 0.016316872090101242,
      "rmse_dy": 0.007566011045128107,
      "rmse_mean": 0.0282134972512722,
      "rotation_flip": 0.018382353708148003,
      "sparse_tokens": 12535.0,
      "step": 6825,
      "turn_loss": 0.23967798054218292,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.31713436164281733,
      "grad_norm": 0.4311225712299347,
      "learning_rate": 3.995387534803006e-06,
      "loss": 0.0831,
      "mae_dtheta": 0.0294603630900383,
      "mae_dx": 0.005751840770244598,
      "mae_dy": 0.0024341298267245293,
      "pose_mae_dtheta": 0.22709739208221436,
      "pose_mae_dx": 0.03596758469939232,
      "pose_mae_dy": 0.02729007974267006,
      "pose_rmse_dtheta": 0.4436633586883545,
      "pose_rmse_dx": 0.08467964828014374,
      "pose_rmse_dy": 0.07335960119962692,
      "pose_rmse_mean": 0.20056754350662231,
      "rmse_dtheta": 0.04820093512535095,
      "rmse_dx": 0.01326328981667757,
      "rmse_dy": 0.005409008823335171,
      "rmse_mean": 0.02229107730090618,
      "rotation_flip": 0.011709601618349552,
      "sparse_tokens": 6003.0,
      "step": 6826,
      "turn_loss": 0.22812557220458984,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 24338.0,
      "epoch": 0.3171808214086601,
      "grad_norm": 0.5003061890602112,
      "learning_rate": 3.994092314641903e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.03311842679977417,
      "mae_dx": 0.011470012366771698,
      "mae_dy": 0.00508858310058713,
      "pose_mae_dtheta": 0.21816664934158325,
      "pose_mae_dx": 0.08118360489606857,
      "pose_mae_dy": 0.06482423841953278,
      "pose_rmse_dtheta": 0.4000321328639984,
      "pose_rmse_dx": 0.18164978921413422,
      "pose_rmse_dy": 0.1412210613489151,
      "pose_rmse_mean": 0.24096766114234924,
      "rmse_dtheta": 0.049586787819862366,
      "rmse_dx": 0.023479584604501724,
      "rmse_dy": 0.009705033153295517,
      "rmse_mean": 0.027590468525886536,
      "rotation_flip": 0.01256281416863203,
      "sparse_tokens": 18243.0,
      "step": 6827,
      "turn_loss": 0.2369338721036911,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.3172272811745029,
      "grad_norm": 0.5441443920135498,
      "learning_rate": 3.9927971648244625e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.024104168638586998,
      "mae_dx": 0.006615480873733759,
      "mae_dy": 0.005662762559950352,
      "pose_mae_dtheta": 0.16976457834243774,
      "pose_mae_dx": 0.047158416360616684,
      "pose_mae_dy": 0.06398314237594604,
      "pose_rmse_dtheta": 0.3425441384315491,
      "pose_rmse_dx": 0.11842940747737885,
      "pose_rmse_dy": 0.18819373846054077,
      "pose_rmse_mean": 0.21638910472393036,
      "rmse_dtheta": 0.04194304347038269,
      "rmse_dx": 0.017251931130886078,
      "rmse_dy": 0.014080219902098179,
      "rmse_mean": 0.024425065144896507,
      "rotation_flip": 0.009230769239366055,
      "sparse_tokens": 6201.0,
      "step": 6828,
      "turn_loss": 0.23803158104419708,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.31727374094034566,
      "grad_norm": 0.38590890169143677,
      "learning_rate": 3.991502085441259e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.013199136592447758,
      "mae_dx": 0.0018454655073583126,
      "mae_dy": 0.004158125724643469,
      "pose_mae_dtheta": 0.08274351805448532,
      "pose_mae_dx": 0.026497570797801018,
      "pose_mae_dy": 0.042273566126823425,
      "pose_rmse_dtheta": 0.16142337024211884,
      "pose_rmse_dx": 0.0659133568406105,
      "pose_rmse_dy": 0.09777278453111649,
      "pose_rmse_mean": 0.108369842171669,
      "rmse_dtheta": 0.02366546168923378,
      "rmse_dx": 0.004629210568964481,
      "rmse_dy": 0.00882833544164896,
      "rmse_mean": 0.012374335899949074,
      "rotation_flip": 0.0057862489484250546,
      "sparse_tokens": 32089.0,
      "step": 6829,
      "turn_loss": 0.11692434549331665,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8789.0,
      "epoch": 0.31732020070618844,
      "grad_norm": 1.2590347528457642,
      "learning_rate": 3.990207076582854e-06,
      "loss": 0.2471,
      "mae_dtheta": 0.031819093972444534,
      "mae_dx": 0.01247330941259861,
      "mae_dy": 0.003930921200662851,
      "pose_mae_dtheta": 0.253007173538208,
      "pose_mae_dx": 0.10490306466817856,
      "pose_mae_dy": 0.050260402262210846,
      "pose_rmse_dtheta": 0.4360027015209198,
      "pose_rmse_dx": 0.2439010888338089,
      "pose_rmse_dy": 0.11316506564617157,
      "pose_rmse_mean": 0.2643563151359558,
      "rmse_dtheta": 0.04855728521943092,
      "rmse_dx": 0.025263937190175056,
      "rmse_dy": 0.007567289751023054,
      "rmse_mean": 0.027129504829645157,
      "rotation_flip": 0.004866180010139942,
      "sparse_tokens": 6971.0,
      "step": 6830,
      "turn_loss": 0.24336330592632294,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.3173666604720312,
      "grad_norm": 0.6464802026748657,
      "learning_rate": 3.988912138339812e-06,
      "loss": 0.1464,
      "mae_dtheta": 0.038944683969020844,
      "mae_dx": 0.014312862418591976,
      "mae_dy": 0.004918516147881746,
      "pose_mae_dtheta": 0.335043340921402,
      "pose_mae_dx": 0.10873762518167496,
      "pose_mae_dy": 0.08602191507816315,
      "pose_rmse_dtheta": 0.533049464225769,
      "pose_rmse_dx": 0.23127618432044983,
      "pose_rmse_dy": 0.19183960556983948,
      "pose_rmse_mean": 0.318721741437912,
      "rmse_dtheta": 0.055710434913635254,
      "rmse_dx": 0.028497306630015373,
      "rmse_dy": 0.00861654244363308,
      "rmse_mean": 0.0309414304792881,
      "rotation_flip": 0.010075566358864307,
      "sparse_tokens": 6644.0,
      "step": 6831,
      "turn_loss": 0.3122469186782837,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.317413120237874,
      "grad_norm": 0.9623333811759949,
      "learning_rate": 3.987617270802685e-06,
      "loss": 0.143,
      "mae_dtheta": 0.039248280227184296,
      "mae_dx": 0.010757547803223133,
      "mae_dy": 0.007270466536283493,
      "pose_mae_dtheta": 0.3638305068016052,
      "pose_mae_dx": 0.09241107106208801,
      "pose_mae_dy": 0.10385026782751083,
      "pose_rmse_dtheta": 0.5915324091911316,
      "pose_rmse_dx": 0.19669297337532043,
      "pose_rmse_dy": 0.22677761316299438,
      "pose_rmse_mean": 0.338334321975708,
      "rmse_dtheta": 0.05629603937268257,
      "rmse_dx": 0.022178471088409424,
      "rmse_dy": 0.014880421571433544,
      "rmse_mean": 0.031118309125304222,
      "rotation_flip": 0.016181230545043945,
      "sparse_tokens": 5257.0,
      "step": 6832,
      "turn_loss": 0.28237029910087585,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.31745958000371677,
      "grad_norm": 0.5007117390632629,
      "learning_rate": 3.986322474062025e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.00826447457075119,
      "mae_dx": 0.001281579490751028,
      "mae_dy": 0.0017039255471900105,
      "pose_mae_dtheta": 0.05300207436084747,
      "pose_mae_dx": 0.01671721786260605,
      "pose_mae_dy": 0.02076406590640545,
      "pose_rmse_dtheta": 0.10604202002286911,
      "pose_rmse_dx": 0.039544954895973206,
      "pose_rmse_dy": 0.04422031342983246,
      "pose_rmse_mean": 0.06326909363269806,
      "rmse_dtheta": 0.0172104574739933,
      "rmse_dx": 0.003832952119410038,
      "rmse_dy": 0.0036243514623492956,
      "rmse_mean": 0.008222587406635284,
      "rotation_flip": 0.0026187803596258163,
      "sparse_tokens": 32137.0,
      "step": 6833,
      "turn_loss": 0.06406956166028976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.31750603976955954,
      "grad_norm": 0.3764382302761078,
      "learning_rate": 3.985027748208381e-06,
      "loss": 0.09,
      "mae_dtheta": 0.014026663266122341,
      "mae_dx": 0.003579089418053627,
      "mae_dy": 0.0030432112980633974,
      "pose_mae_dtheta": 0.08959706872701645,
      "pose_mae_dx": 0.03217987343668938,
      "pose_mae_dy": 0.04416675865650177,
      "pose_rmse_dtheta": 0.1680959165096283,
      "pose_rmse_dx": 0.09927748888731003,
      "pose_rmse_dy": 0.10010269284248352,
      "pose_rmse_mean": 0.12249203771352768,
      "rmse_dtheta": 0.025840269401669502,
      "rmse_dx": 0.011909494176506996,
      "rmse_dy": 0.006303200963884592,
      "rmse_mean": 0.014684322290122509,
      "rotation_flip": 0.0072289155796170235,
      "sparse_tokens": 10708.0,
      "step": 6834,
      "turn_loss": 0.12633998692035675,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3175524995354023,
      "grad_norm": 0.3527891933917999,
      "learning_rate": 3.9837330933322895e-06,
      "loss": 0.0947,
      "mae_dtheta": 0.008590960875153542,
      "mae_dx": 0.00171349523589015,
      "mae_dy": 0.0022962423972785473,
      "pose_mae_dtheta": 0.057197410613298416,
      "pose_mae_dx": 0.020003249868750572,
      "pose_mae_dy": 0.022825073450803757,
      "pose_rmse_dtheta": 0.12241873890161514,
      "pose_rmse_dx": 0.05371672660112381,
      "pose_rmse_dy": 0.05497989058494568,
      "pose_rmse_mean": 0.07703845202922821,
      "rmse_dtheta": 0.018296344205737114,
      "rmse_dx": 0.005240155849605799,
      "rmse_dy": 0.005391045473515987,
      "rmse_mean": 0.009642515331506729,
      "rotation_flip": 0.003877471899613738,
      "sparse_tokens": 32089.0,
      "step": 6835,
      "turn_loss": 0.08421878516674042,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3175989593012451,
      "grad_norm": 0.5657617449760437,
      "learning_rate": 3.98243850952429e-06,
      "loss": 0.1446,
      "mae_dtheta": 0.005912864580750465,
      "mae_dx": 0.001138429157435894,
      "mae_dy": 0.0011500620748847723,
      "pose_mae_dtheta": 0.04044487327337265,
      "pose_mae_dx": 0.012066427618265152,
      "pose_mae_dy": 0.016206592321395874,
      "pose_rmse_dtheta": 0.1062435507774353,
      "pose_rmse_dx": 0.03651115298271179,
      "pose_rmse_dy": 0.03835715726017952,
      "pose_rmse_mean": 0.06037062034010887,
      "rmse_dtheta": 0.015724899247288704,
      "rmse_dx": 0.0037918512243777514,
      "rmse_dy": 0.0027640829794108868,
      "rmse_mean": 0.007426945026963949,
      "rotation_flip": 0.0028901733458042145,
      "sparse_tokens": 32057.0,
      "step": 6836,
      "turn_loss": 0.041914112865924835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.3176454190670879,
      "grad_norm": 0.45058727264404297,
      "learning_rate": 3.981143996874909e-06,
      "loss": 0.1429,
      "mae_dtheta": 0.041562069207429886,
      "mae_dx": 0.0088085001334548,
      "mae_dy": 0.0040358020924031734,
      "pose_mae_dtheta": 0.34272387623786926,
      "pose_mae_dx": 0.0740867629647255,
      "pose_mae_dy": 0.04243834316730499,
      "pose_rmse_dtheta": 0.5435141921043396,
      "pose_rmse_dx": 0.16779780387878418,
      "pose_rmse_dy": 0.11226718872785568,
      "pose_rmse_mean": 0.2745264172554016,
      "rmse_dtheta": 0.058822669088840485,
      "rmse_dx": 0.01853133551776409,
      "rmse_dy": 0.010585299693048,
      "rmse_mean": 0.0293131023645401,
      "rotation_flip": 0.02072909288108349,
      "sparse_tokens": 20772.0,
      "step": 6837,
      "turn_loss": 0.28916671872138977,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.3176918788329307,
      "grad_norm": 0.7980451583862305,
      "learning_rate": 3.979849555474678e-06,
      "loss": 0.1834,
      "mae_dtheta": 0.03689257428050041,
      "mae_dx": 0.018143383786082268,
      "mae_dy": 0.005710243247449398,
      "pose_mae_dtheta": 0.2904368042945862,
      "pose_mae_dx": 0.13751552999019623,
      "pose_mae_dy": 0.06998179852962494,
      "pose_rmse_dtheta": 0.49548542499542236,
      "pose_rmse_dx": 0.28829440474510193,
      "pose_rmse_dy": 0.14956870675086975,
      "pose_rmse_mean": 0.31111618876457214,
      "rmse_dtheta": 0.05348587408661842,
      "rmse_dx": 0.03205909952521324,
      "rmse_dy": 0.012033068574965,
      "rmse_mean": 0.03252601623535156,
      "rotation_flip": 0.010135134682059288,
      "sparse_tokens": 14388.0,
      "step": 6838,
      "turn_loss": 0.33834898471832275,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3177383385987735,
      "grad_norm": 0.5882230997085571,
      "learning_rate": 3.978555185414113e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.011452240869402885,
      "mae_dx": 0.0025684628635644913,
      "mae_dy": 0.0028367070481181145,
      "pose_mae_dtheta": 0.0751582607626915,
      "pose_mae_dx": 0.03515633940696716,
      "pose_mae_dy": 0.03533156216144562,
      "pose_rmse_dtheta": 0.16541039943695068,
      "pose_rmse_dx": 0.09638849645853043,
      "pose_rmse_dy": 0.09488889575004578,
      "pose_rmse_mean": 0.11889593303203583,
      "rmse_dtheta": 0.023727701976895332,
      "rmse_dx": 0.007969080470502377,
      "rmse_dy": 0.006427486892789602,
      "rmse_mean": 0.01270808931440115,
      "rotation_flip": 0.005185185000300407,
      "sparse_tokens": 32105.0,
      "step": 6839,
      "turn_loss": 0.11134170740842819,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.31778479836461626,
      "grad_norm": 0.6781584620475769,
      "learning_rate": 3.9772608867837314e-06,
      "loss": 0.0847,
      "mae_dtheta": 0.04104697331786156,
      "mae_dx": 0.006714044604450464,
      "mae_dy": 0.00731574697420001,
      "pose_mae_dtheta": 0.3346659541130066,
      "pose_mae_dx": 0.047236476093530655,
      "pose_mae_dy": 0.06464923173189163,
      "pose_rmse_dtheta": 0.5885561108589172,
      "pose_rmse_dx": 0.09673800319433212,
      "pose_rmse_dy": 0.13175521790981293,
      "pose_rmse_mean": 0.2723497748374939,
      "rmse_dtheta": 0.059879593551158905,
      "rmse_dx": 0.014300083741545677,
      "rmse_dy": 0.014627544209361076,
      "rmse_mean": 0.029602408409118652,
      "rotation_flip": 0.020618556067347527,
      "sparse_tokens": 4740.0,
      "step": 6840,
      "turn_loss": 0.23379385471343994,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.31783125813045904,
      "grad_norm": 0.5358520150184631,
      "learning_rate": 3.975966659674048e-06,
      "loss": 0.1239,
      "mae_dtheta": 0.041500139981508255,
      "mae_dx": 0.014471838250756264,
      "mae_dy": 0.014794398099184036,
      "pose_mae_dtheta": 0.33300620317459106,
      "pose_mae_dx": 0.09501118212938309,
      "pose_mae_dy": 0.15135863423347473,
      "pose_rmse_dtheta": 0.6399779915809631,
      "pose_rmse_dx": 0.17005345225334167,
      "pose_rmse_dy": 0.2866770327091217,
      "pose_rmse_mean": 0.36556947231292725,
      "rmse_dtheta": 0.0622808076441288,
      "rmse_dx": 0.026851888746023178,
      "rmse_dy": 0.024200547486543655,
      "rmse_mean": 0.037777747958898544,
      "rotation_flip": 0.012345679104328156,
      "sparse_tokens": 2800.0,
      "step": 6841,
      "turn_loss": 0.5239723920822144,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3178777178963018,
      "grad_norm": 0.4871235489845276,
      "learning_rate": 3.974672504175563e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.013010532595217228,
      "mae_dx": 0.001876892987638712,
      "mae_dy": 0.0032647629268467426,
      "pose_mae_dtheta": 0.07634879648685455,
      "pose_mae_dx": 0.02281242422759533,
      "pose_mae_dy": 0.031149476766586304,
      "pose_rmse_dtheta": 0.1790839433670044,
      "pose_rmse_dx": 0.06394488364458084,
      "pose_rmse_dy": 0.06909959018230438,
      "pose_rmse_mean": 0.10404281318187714,
      "rmse_dtheta": 0.0264385137706995,
      "rmse_dx": 0.005843020044267178,
      "rmse_dy": 0.007741117849946022,
      "rmse_mean": 0.013340882956981659,
      "rotation_flip": 0.008148147724568844,
      "sparse_tokens": 32073.0,
      "step": 6842,
      "turn_loss": 0.10876750946044922,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.3179241776621446,
      "grad_norm": 0.4602808952331543,
      "learning_rate": 3.973378420378782e-06,
      "loss": 0.1022,
      "mae_dtheta": 0.03714931756258011,
      "mae_dx": 0.015121830627322197,
      "mae_dy": 0.005557938478887081,
      "pose_mae_dtheta": 0.29474523663520813,
      "pose_mae_dx": 0.12097258865833282,
      "pose_mae_dy": 0.054130762815475464,
      "pose_rmse_dtheta": 0.48562899231910706,
      "pose_rmse_dx": 0.24856896698474884,
      "pose_rmse_dy": 0.11607015877962112,
      "pose_rmse_mean": 0.28342270851135254,
      "rmse_dtheta": 0.053015101701021194,
      "rmse_dx": 0.02793888747692108,
      "rmse_dy": 0.010063924826681614,
      "rmse_mean": 0.030339304357767105,
      "rotation_flip": 0.010647010989487171,
      "sparse_tokens": 19805.0,
      "step": 6843,
      "turn_loss": 0.30057626962661743,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.31797063742798737,
      "grad_norm": 0.43267273902893066,
      "learning_rate": 3.972084408374198e-06,
      "loss": 0.0979,
      "mae_dtheta": 0.008060810156166553,
      "mae_dx": 0.0012274805922061205,
      "mae_dy": 0.0021754279732704163,
      "pose_mae_dtheta": 0.04780300334095955,
      "pose_mae_dx": 0.019233742728829384,
      "pose_mae_dy": 0.02247663587331772,
      "pose_rmse_dtheta": 0.09355234354734421,
      "pose_rmse_dx": 0.04502382501959801,
      "pose_rmse_dy": 0.04915475472807884,
      "pose_rmse_mean": 0.06257697939872742,
      "rmse_dtheta": 0.017483126372098923,
      "rmse_dx": 0.003185676410794258,
      "rmse_dy": 0.004516354762017727,
      "rmse_mean": 0.008395052514970303,
      "rotation_flip": 0.005649717524647713,
      "sparse_tokens": 32089.0,
      "step": 6844,
      "turn_loss": 0.07107595354318619,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.31801709719383014,
      "grad_norm": 0.6164233088493347,
      "learning_rate": 3.970790468252302e-06,
      "loss": 0.1405,
      "mae_dtheta": 0.014039505273103714,
      "mae_dx": 0.003133530495688319,
      "mae_dy": 0.003447797615081072,
      "pose_mae_dtheta": 0.09230437874794006,
      "pose_mae_dx": 0.03231680765748024,
      "pose_mae_dy": 0.039127230644226074,
      "pose_rmse_dtheta": 0.19900581240653992,
      "pose_rmse_dx": 0.07685911655426025,
      "pose_rmse_dy": 0.08936558663845062,
      "pose_rmse_mean": 0.12174350023269653,
      "rmse_dtheta": 0.02717737853527069,
      "rmse_dx": 0.010316169820725918,
      "rmse_dy": 0.007522379048168659,
      "rmse_mean": 0.015005309134721756,
      "rotation_flip": 0.015075377188622952,
      "sparse_tokens": 32137.0,
      "step": 6845,
      "turn_loss": 0.1310518980026245,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3180635569596729,
      "grad_norm": 0.39117786288261414,
      "learning_rate": 3.969496600103583e-06,
      "loss": 0.0811,
      "mae_dtheta": 0.009762114845216274,
      "mae_dx": 0.0018418952822685242,
      "mae_dy": 0.0026911876630038023,
      "pose_mae_dtheta": 0.05880584567785263,
      "pose_mae_dx": 0.017801126465201378,
      "pose_mae_dy": 0.026515210047364235,
      "pose_rmse_dtheta": 0.11083604395389557,
      "pose_rmse_dx": 0.04319649934768677,
      "pose_rmse_dy": 0.056029126048088074,
      "pose_rmse_mean": 0.07002055644989014,
      "rmse_dtheta": 0.018799006938934326,
      "rmse_dx": 0.005303512327373028,
      "rmse_dy": 0.0061555905267596245,
      "rmse_mean": 0.01008603721857071,
      "rotation_flip": 0.007868115790188313,
      "sparse_tokens": 32089.0,
      "step": 6846,
      "turn_loss": 0.08249257504940033,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.3181100167255157,
      "grad_norm": 0.6151654124259949,
      "learning_rate": 3.968202804018519e-06,
      "loss": 0.1143,
      "mae_dtheta": 0.011658482253551483,
      "mae_dx": 0.0021959461737424135,
      "mae_dy": 0.002419812139123678,
      "pose_mae_dtheta": 0.0772513896226883,
      "pose_mae_dx": 0.027029424905776978,
      "pose_mae_dy": 0.02646525762975216,
      "pose_rmse_dtheta": 0.20010879635810852,
      "pose_rmse_dx": 0.060604847967624664,
      "pose_rmse_dy": 0.057554155588150024,
      "pose_rmse_mean": 0.1060892641544342,
      "rmse_dtheta": 0.025336584076285362,
      "rmse_dx": 0.005658748093992472,
      "rmse_dy": 0.005174451973289251,
      "rmse_mean": 0.012056594714522362,
      "rotation_flip": 0.007989773526787758,
      "sparse_tokens": 32217.0,
      "step": 6847,
      "turn_loss": 0.08740785717964172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.3181564764913585,
      "grad_norm": 0.3942387104034424,
      "learning_rate": 3.9669090800875874e-06,
      "loss": 0.1172,
      "mae_dtheta": 0.04239767789840698,
      "mae_dx": 0.012373177334666252,
      "mae_dy": 0.004995195660740137,
      "pose_mae_dtheta": 0.30769217014312744,
      "pose_mae_dx": 0.10336939990520477,
      "pose_mae_dy": 0.06415191292762756,
      "pose_rmse_dtheta": 0.5240928530693054,
      "pose_rmse_dx": 0.21123938262462616,
      "pose_rmse_dy": 0.13964226841926575,
      "pose_rmse_mean": 0.2916581630706787,
      "rmse_dtheta": 0.061792485415935516,
      "rmse_dx": 0.02449212223291397,
      "rmse_dy": 0.008936351165175438,
      "rmse_mean": 0.03174032270908356,
      "rotation_flip": 0.019801979884505272,
      "sparse_tokens": 8520.0,
      "step": 6848,
      "turn_loss": 0.2833292484283447,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.31820293625720125,
      "grad_norm": 0.564834475517273,
      "learning_rate": 3.965615428401257e-06,
      "loss": 0.1118,
      "mae_dtheta": 0.009231064468622208,
      "mae_dx": 0.0014590466162189841,
      "mae_dy": 0.001500189770013094,
      "pose_mae_dtheta": 0.06346262246370316,
      "pose_mae_dx": 0.014100609347224236,
      "pose_mae_dy": 0.021382847800850868,
      "pose_rmse_dtheta": 0.1649547815322876,
      "pose_rmse_dx": 0.03688760846853256,
      "pose_rmse_dy": 0.04767797887325287,
      "pose_rmse_mean": 0.08317346125841141,
      "rmse_dtheta": 0.02234295941889286,
      "rmse_dx": 0.0051401713863015175,
      "rmse_dy": 0.0029102934058755636,
      "rmse_mean": 0.010131142102181911,
      "rotation_flip": 0.0029411765281111,
      "sparse_tokens": 32121.0,
      "step": 6849,
      "turn_loss": 0.07039697468280792,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.31824939602304403,
      "grad_norm": 0.48245254158973694,
      "learning_rate": 3.964321849049997e-06,
      "loss": 0.1354,
      "mae_dtheta": 0.004467949271202087,
      "mae_dx": 0.0011022391263395548,
      "mae_dy": 0.0009737013606354594,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4824525713920593,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 166.66195678710938,
      "model/head/act_norm_mean": 127.29947916666667,
      "model/head/act_norm_min": 75.76243591308594,
      "model/head/act_over_embed": 87.48139387983436,
      "model/head/grad_frac": 0.1206309124827385,
      "model/head/grad_norm": 0.05819869413971901,
      "model/head/grad_zero_frac": 0.0001573667977936566,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6999289772727273,
      "model/head/update_ratio": 0.0009928463259711862,
      "model/head/weight_delta": 9.329695701599121,
      "model/head/weight_delta_rel": 0.16367049515247345,
      "model/head/weight_norm": 58.61802673339844,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4215450584888458,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42147482257999785,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.421414315700531,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2896414439864323,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12738022208213806,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06145491451025009,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.520806578196347,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001985319424420595,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0053157806396484,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09819303452968597,
      "model/modality_embedder.encoders.pose/weight_norm": 30.95467185974121,
      "model/modality_embedder/grad_frac": 0.12738022208213806,
      "model/modality_embedder/grad_norm": 0.06145491451025009,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.520806578196347,
      "model/modality_embedder/update_ratio": 0.001985319424420595,
      "model/modality_embedder/weight_delta": 3.0053157806396484,
      "model/modality_embedder/weight_delta_rel": 0.09819303452968597,
      "model/modality_embedder/weight_norm": 30.95467185974121,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.38629913330078,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.2909927649511,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.049749374389648,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.38020700607916,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08946167677640915,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04316101595759392,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001547283842228353,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.436249256134033,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08877839148044586,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.894699096679688,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.58385467529297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.324697871572873,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.222869873046875,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.090578833049324,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08748964220285416,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.042209602892398834,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014231493696570396,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.087594509124756,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10695669054985046,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.659292221069336,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.42554473876953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.200216450216452,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.234772682189941,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.37945275917477,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08795589953660965,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04243455082178116,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013856594450771809,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.3327200412750244,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.111906498670578,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.62408447265625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.00273132324219,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.89489137405804,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.936554908752441,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.544049232635317,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0953076034784317,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04598139971494675,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015396182425320148,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8503787517547607,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09741242229938507,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.865455627441406,
      "model/normalizer/grad_frac": 0.33397600054740906,
      "model/normalizer/grad_norm": 0.16112758219242096,
      "model/normalizer/grad_zero_frac": 0.0001855329319369048,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002051691524684429,
      "model/normalizer/weight_delta": 6.027927398681641,
      "model/normalizer/weight_delta_rel": 0.07763621211051941,
      "model/normalizer/weight_norm": 78.53401947021484,
      "pose_mae_dtheta": 0.0323459692299366,
      "pose_mae_dx": 0.008596471510827541,
      "pose_mae_dy": 0.011510125361382961,
      "pose_rmse_dtheta": 0.09313496202230453,
      "pose_rmse_dx": 0.024575022980570793,
      "pose_rmse_dy": 0.03222845122218132,
      "pose_rmse_mean": 0.04997947812080383,
      "rmse_dtheta": 0.012737966142594814,
      "rmse_dx": 0.004483303986489773,
      "rmse_dy": 0.0032208014745265245,
      "rmse_mean": 0.006814024411141872,
      "rotation_flip": 0.005536332260817289,
      "sparse_tokens": 32073.0,
      "step": 6850,
      "turn_loss": 0.04140927270054817,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3182958557888868,
      "grad_norm": 0.44630858302116394,
      "learning_rate": 3.9630283421242645e-06,
      "loss": 0.1188,
      "mae_dtheta": 0.008666140958666801,
      "mae_dx": 0.002493796870112419,
      "mae_dy": 0.002287741517648101,
      "pose_mae_dtheta": 0.058813899755477905,
      "pose_mae_dx": 0.01743733510375023,
      "pose_mae_dy": 0.01983608677983284,
      "pose_rmse_dtheta": 0.16657768189907074,
      "pose_rmse_dx": 0.04908820614218712,
      "pose_rmse_dy": 0.0528971329331398,
      "pose_rmse_mean": 0.08952101320028305,
      "rmse_dtheta": 0.02282596379518509,
      "rmse_dx": 0.00790385901927948,
      "rmse_dy": 0.008091154508292675,
      "rmse_mean": 0.01294032670557499,
      "rotation_flip": 0.006921824067831039,
      "sparse_tokens": 32169.0,
      "step": 6851,
      "turn_loss": 0.07962501049041748,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15866.0,
      "epoch": 0.3183423155547296,
      "grad_norm": 0.5026001930236816,
      "learning_rate": 3.9617349077145166e-06,
      "loss": 0.1363,
      "mae_dtheta": 0.03495921194553375,
      "mae_dx": 0.012068301439285278,
      "mae_dy": 0.004190816078335047,
      "pose_mae_dtheta": 0.2882723808288574,
      "pose_mae_dx": 0.10773881524801254,
      "pose_mae_dy": 0.07490546256303787,
      "pose_rmse_dtheta": 0.5043953657150269,
      "pose_rmse_dx": 0.21154804527759552,
      "pose_rmse_dy": 0.174969881772995,
      "pose_rmse_mean": 0.29697108268737793,
      "rmse_dtheta": 0.053347308188676834,
      "rmse_dx": 0.02422051690518856,
      "rmse_dy": 0.00746917026117444,
      "rmse_mean": 0.028345664963126183,
      "rotation_flip": 0.0163690485060215,
      "sparse_tokens": 13442.0,
      "step": 6852,
      "turn_loss": 0.24542571604251862,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.31838877532057236,
      "grad_norm": 0.7733880281448364,
      "learning_rate": 3.960441545911205e-06,
      "loss": 0.1499,
      "mae_dtheta": 0.020948214456439018,
      "mae_dx": 0.006971712689846754,
      "mae_dy": 0.0030922696460038424,
      "pose_mae_dtheta": 0.1475575566291809,
      "pose_mae_dx": 0.06168937683105469,
      "pose_mae_dy": 0.03434446454048157,
      "pose_rmse_dtheta": 0.2813224792480469,
      "pose_rmse_dx": 0.14414063096046448,
      "pose_rmse_dy": 0.09088413417339325,
      "pose_rmse_mean": 0.1721157431602478,
      "rmse_dtheta": 0.03767828270792961,
      "rmse_dx": 0.017406582832336426,
      "rmse_dy": 0.006652893498539925,
      "rmse_mean": 0.020579254254698753,
      "rotation_flip": 0.011952191591262817,
      "sparse_tokens": 9231.0,
      "step": 6853,
      "turn_loss": 0.14353913068771362,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 31143.0,
      "epoch": 0.3184352350864152,
      "grad_norm": 0.5678187012672424,
      "learning_rate": 3.9591482568047716e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.03227062150835991,
      "mae_dx": 0.014259932562708855,
      "mae_dy": 0.002905433066189289,
      "pose_mae_dtheta": 0.2462853193283081,
      "pose_mae_dx": 0.11663584411144257,
      "pose_mae_dy": 0.03664778918027878,
      "pose_rmse_dtheta": 0.4601704180240631,
      "pose_rmse_dx": 0.264018714427948,
      "pose_rmse_dy": 0.10248123109340668,
      "pose_rmse_mean": 0.2755568027496338,
      "rmse_dtheta": 0.05020518973469734,
      "rmse_dx": 0.028511669486761093,
      "rmse_dy": 0.0061493911780416965,
      "rmse_mean": 0.02828874997794628,
      "rotation_flip": 0.007953723892569542,
      "sparse_tokens": 24766.0,
      "step": 6854,
      "turn_loss": 0.2513200342655182,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.31848169485225797,
      "grad_norm": 0.8864291906356812,
      "learning_rate": 3.957855040485662e-06,
      "loss": 0.195,
      "mae_dtheta": 0.03798910602927208,
      "mae_dx": 0.017559492960572243,
      "mae_dy": 0.007167340721935034,
      "pose_mae_dtheta": 0.32162028551101685,
      "pose_mae_dx": 0.1418188065290451,
      "pose_mae_dy": 0.08308213949203491,
      "pose_rmse_dtheta": 0.5288576483726501,
      "pose_rmse_dx": 0.28508472442626953,
      "pose_rmse_dy": 0.17940378189086914,
      "pose_rmse_mean": 0.33111539483070374,
      "rmse_dtheta": 0.054916393011808395,
      "rmse_dx": 0.030745334923267365,
      "rmse_dy": 0.015238855965435505,
      "rmse_mean": 0.033633530139923096,
      "rotation_flip": 0.009756097570061684,
      "sparse_tokens": 17528.0,
      "step": 6855,
      "turn_loss": 0.3914760649204254,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.31852815461810075,
      "grad_norm": 0.5989631414413452,
      "learning_rate": 3.956561897044306e-06,
      "loss": 0.1062,
      "mae_dtheta": 0.03844347596168518,
      "mae_dx": 0.015143022872507572,
      "mae_dy": 0.009750505909323692,
      "pose_mae_dtheta": 0.2901066243648529,
      "pose_mae_dx": 0.13588185608386993,
      "pose_mae_dy": 0.09649105370044708,
      "pose_rmse_dtheta": 0.502896249294281,
      "pose_rmse_dx": 0.2569415271282196,
      "pose_rmse_dy": 0.20967969298362732,
      "pose_rmse_mean": 0.32317250967025757,
      "rmse_dtheta": 0.05668908357620239,
      "rmse_dx": 0.027207408100366592,
      "rmse_dy": 0.018533624708652496,
      "rmse_mean": 0.03414337337017059,
      "rotation_flip": 0.017189079895615578,
      "sparse_tokens": 17216.0,
      "step": 6856,
      "turn_loss": 0.35379862785339355,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.3185746143839435,
      "grad_norm": 0.7759102582931519,
      "learning_rate": 3.95526882657114e-06,
      "loss": 0.2945,
      "mae_dtheta": 0.038187798112630844,
      "mae_dx": 0.007675205823034048,
      "mae_dy": 0.006016029976308346,
      "pose_mae_dtheta": 0.32286080718040466,
      "pose_mae_dx": 0.06871866434812546,
      "pose_mae_dy": 0.06022645905613899,
      "pose_rmse_dtheta": 0.5705318450927734,
      "pose_rmse_dx": 0.1305798590183258,
      "pose_rmse_dy": 0.12321691960096359,
      "pose_rmse_mean": 0.2747762203216553,
      "rmse_dtheta": 0.05706648901104927,
      "rmse_dx": 0.015440225601196289,
      "rmse_dy": 0.01037861779332161,
      "rmse_mean": 0.027628442272543907,
      "rotation_flip": 0.01900237612426281,
      "sparse_tokens": 8676.0,
      "step": 6857,
      "turn_loss": 0.24426521360874176,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3186210741497863,
      "grad_norm": 0.5194181203842163,
      "learning_rate": 3.953975829156583e-06,
      "loss": 0.1147,
      "mae_dtheta": 0.012077268213033676,
      "mae_dx": 0.002216510009020567,
      "mae_dy": 0.002505261916667223,
      "pose_mae_dtheta": 0.08539461344480515,
      "pose_mae_dx": 0.02510090172290802,
      "pose_mae_dy": 0.024833137169480324,
      "pose_rmse_dtheta": 0.22679364681243896,
      "pose_rmse_dx": 0.06502571702003479,
      "pose_rmse_dy": 0.055361561477184296,
      "pose_rmse_mean": 0.11572697758674622,
      "rmse_dtheta": 0.027428938075900078,
      "rmse_dx": 0.007088677491992712,
      "rmse_dy": 0.0058692763559520245,
      "rmse_mean": 0.01346229761838913,
      "rotation_flip": 0.0030177291482686996,
      "sparse_tokens": 32121.0,
      "step": 6858,
      "turn_loss": 0.09052332490682602,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3186675339156291,
      "grad_norm": 0.5333642959594727,
      "learning_rate": 3.952682904891058e-06,
      "loss": 0.1005,
      "mae_dtheta": 0.007856297306716442,
      "mae_dx": 0.0014985355082899332,
      "mae_dy": 0.0006392857758328319,
      "pose_mae_dtheta": 0.05935771390795708,
      "pose_mae_dx": 0.011623776517808437,
      "pose_mae_dy": 0.010484209284186363,
      "pose_rmse_dtheta": 0.23568563163280487,
      "pose_rmse_dx": 0.03289598226547241,
      "pose_rmse_dy": 0.028806446120142937,
      "pose_rmse_mean": 0.09912936389446259,
      "rmse_dtheta": 0.02669331431388855,
      "rmse_dx": 0.004979715216904879,
      "rmse_dy": 0.0015663276426494122,
      "rmse_mean": 0.011079786345362663,
      "rotation_flip": 0.0030534351244568825,
      "sparse_tokens": 32121.0,
      "step": 6859,
      "turn_loss": 0.047643162310123444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.31871399368147185,
      "grad_norm": 0.5356707572937012,
      "learning_rate": 3.951390053864981e-06,
      "loss": 0.1011,
      "mae_dtheta": 0.036747027188539505,
      "mae_dx": 0.01245738472789526,
      "mae_dy": 0.006483121309429407,
      "pose_mae_dtheta": 0.31026268005371094,
      "pose_mae_dx": 0.09228058904409409,
      "pose_mae_dy": 0.07838273793458939,
      "pose_rmse_dtheta": 0.5075879693031311,
      "pose_rmse_dx": 0.20098236203193665,
      "pose_rmse_dy": 0.17627966403961182,
      "pose_rmse_mean": 0.294950008392334,
      "rmse_dtheta": 0.05558657646179199,
      "rmse_dx": 0.025859594345092773,
      "rmse_dy": 0.012706086970865726,
      "rmse_mean": 0.03138408809900284,
      "rotation_flip": 0.01577909290790558,
      "sparse_tokens": 8330.0,
      "step": 6860,
      "turn_loss": 0.3783860504627228,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.31876045344731463,
      "grad_norm": 0.38933300971984863,
      "learning_rate": 3.950097276168758e-06,
      "loss": 0.134,
      "mae_dtheta": 0.04929625615477562,
      "mae_dx": 0.003956194501370192,
      "mae_dy": 0.002549126511439681,
      "pose_mae_dtheta": 0.42979535460472107,
      "pose_mae_dx": 0.04030831903219223,
      "pose_mae_dy": 0.022951247170567513,
      "pose_rmse_dtheta": 0.7397833466529846,
      "pose_rmse_dx": 0.14261768758296967,
      "pose_rmse_dy": 0.06995569914579391,
      "pose_rmse_mean": 0.31745225191116333,
      "rmse_dtheta": 0.07368195056915283,
      "rmse_dx": 0.013995938934385777,
      "rmse_dy": 0.009344770573079586,
      "rmse_mean": 0.0323408879339695,
      "rotation_flip": 0.009036144241690636,
      "sparse_tokens": 5365.0,
      "step": 6861,
      "turn_loss": 0.3113469183444977,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.3188069132131574,
      "grad_norm": 0.4593852162361145,
      "learning_rate": 3.948804571892799e-06,
      "loss": 0.1197,
      "mae_dtheta": 0.03970615193247795,
      "mae_dx": 0.01252531073987484,
      "mae_dy": 0.006208093371242285,
      "pose_mae_dtheta": 0.28162580728530884,
      "pose_mae_dx": 0.11370399594306946,
      "pose_mae_dy": 0.06747491657733917,
      "pose_rmse_dtheta": 0.42487260699272156,
      "pose_rmse_dx": 0.22410397231578827,
      "pose_rmse_dy": 0.16473621129989624,
      "pose_rmse_mean": 0.2712376117706299,
      "rmse_dtheta": 0.05813339725136757,
      "rmse_dx": 0.024146052077412605,
      "rmse_dy": 0.014319921843707561,
      "rmse_mean": 0.03219979256391525,
      "rotation_flip": 0.01508620660752058,
      "sparse_tokens": 7066.0,
      "step": 6862,
      "turn_loss": 0.4474029541015625,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3188533729790002,
      "grad_norm": 0.41030794382095337,
      "learning_rate": 3.947511941127498e-06,
      "loss": 0.0902,
      "mae_dtheta": 0.010119075886905193,
      "mae_dx": 0.001942431670613587,
      "mae_dy": 0.0022235549986362457,
      "pose_mae_dtheta": 0.07024010270833969,
      "pose_mae_dx": 0.021354053169488907,
      "pose_mae_dy": 0.025563115254044533,
      "pose_rmse_dtheta": 0.17470628023147583,
      "pose_rmse_dx": 0.05833282321691513,
      "pose_rmse_dy": 0.06055184826254845,
      "pose_rmse_mean": 0.09786365926265717,
      "rmse_dtheta": 0.022454721853137016,
      "rmse_dx": 0.0057348390109837055,
      "rmse_dy": 0.004717538133263588,
      "rmse_mean": 0.01096903346478939,
      "rotation_flip": 0.005835765041410923,
      "sparse_tokens": 32089.0,
      "step": 6863,
      "turn_loss": 0.08816894143819809,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.31889983274484296,
      "grad_norm": 0.7241514921188354,
      "learning_rate": 3.946219383963254e-06,
      "loss": 0.1483,
      "mae_dtheta": 0.050027232617139816,
      "mae_dx": 0.006922133732587099,
      "mae_dy": 0.0024618373718112707,
      "pose_mae_dtheta": 0.42268508672714233,
      "pose_mae_dx": 0.04546158388257027,
      "pose_mae_dy": 0.033797770738601685,
      "pose_rmse_dtheta": 0.715437650680542,
      "pose_rmse_dx": 0.10658589750528336,
      "pose_rmse_dy": 0.09865308552980423,
      "pose_rmse_mean": 0.3068922162055969,
      "rmse_dtheta": 0.07089544087648392,
      "rmse_dx": 0.01590549387037754,
      "rmse_dy": 0.0061942157335579395,
      "rmse_mean": 0.030998384580016136,
      "rotation_flip": 0.017214396968483925,
      "sparse_tokens": 9467.0,
      "step": 6864,
      "turn_loss": 0.2978166937828064,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.31894629251068574,
      "grad_norm": 0.9360306262969971,
      "learning_rate": 3.944926900490452e-06,
      "loss": 0.2549,
      "mae_dtheta": 0.028765084221959114,
      "mae_dx": 0.012356436811387539,
      "mae_dy": 0.00868645217269659,
      "pose_mae_dtheta": 0.21902170777320862,
      "pose_mae_dx": 0.10377121716737747,
      "pose_mae_dy": 0.10362245887517929,
      "pose_rmse_dtheta": 0.3335375189781189,
      "pose_rmse_dx": 0.2170233279466629,
      "pose_rmse_dy": 0.18189145624637604,
      "pose_rmse_mean": 0.24415075778961182,
      "rmse_dtheta": 0.037693336606025696,
      "rmse_dx": 0.023708254098892212,
      "rmse_dy": 0.013445074670016766,
      "rmse_mean": 0.024948887526988983,
      "rotation_flip": 0.012820512987673283,
      "sparse_tokens": 5566.0,
      "step": 6865,
      "turn_loss": 0.2983339726924896,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 21682.0,
      "epoch": 0.3189927522765285,
      "grad_norm": 0.6581823229789734,
      "learning_rate": 3.943634490799478e-06,
      "loss": 0.1963,
      "mae_dtheta": 0.02997308224439621,
      "mae_dx": 0.013110210187733173,
      "mae_dy": 0.0043706041760742664,
      "pose_mae_dtheta": 0.2470528483390808,
      "pose_mae_dx": 0.10049231350421906,
      "pose_mae_dy": 0.06475462764501572,
      "pose_rmse_dtheta": 0.45231568813323975,
      "pose_rmse_dx": 0.24538969993591309,
      "pose_rmse_dy": 0.14885276556015015,
      "pose_rmse_mean": 0.2821860611438751,
      "rmse_dtheta": 0.04750926420092583,
      "rmse_dx": 0.02745754085481167,
      "rmse_dy": 0.008890219032764435,
      "rmse_mean": 0.027952341362833977,
      "rotation_flip": 0.008928571827709675,
      "sparse_tokens": 18399.0,
      "step": 6866,
      "turn_loss": 0.22795499861240387,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.3190392120423713,
      "grad_norm": 0.6180806756019592,
      "learning_rate": 3.942342154980713e-06,
      "loss": 0.0597,
      "mae_dtheta": 0.029933977872133255,
      "mae_dx": 0.003972508013248444,
      "mae_dy": 0.008653109893202782,
      "pose_mae_dtheta": 0.2760431468486786,
      "pose_mae_dx": 0.06111428514122963,
      "pose_mae_dy": 0.11781084537506104,
      "pose_rmse_dtheta": 0.5101221203804016,
      "pose_rmse_dx": 0.13458897173404694,
      "pose_rmse_dy": 0.2556365430355072,
      "pose_rmse_mean": 0.3001158833503723,
      "rmse_dtheta": 0.049051426351070404,
      "rmse_dx": 0.0093411635607481,
      "rmse_dy": 0.0149477394297719,
      "rmse_mean": 0.024446777999401093,
      "rotation_flip": 0.01702127605676651,
      "sparse_tokens": 4963.0,
      "step": 6867,
      "turn_loss": 0.2500152885913849,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.31908567180821407,
      "grad_norm": 0.4697079658508301,
      "learning_rate": 3.941049893124527e-06,
      "loss": 0.1513,
      "mae_dtheta": 0.0318700447678566,
      "mae_dx": 0.01059179101139307,
      "mae_dy": 0.004538995213806629,
      "pose_mae_dtheta": 0.24599450826644897,
      "pose_mae_dx": 0.08940212428569794,
      "pose_mae_dy": 0.041269101202487946,
      "pose_rmse_dtheta": 0.43173664808273315,
      "pose_rmse_dx": 0.17745423316955566,
      "pose_rmse_dy": 0.10473533719778061,
      "pose_rmse_mean": 0.23797540366649628,
      "rmse_dtheta": 0.04993914067745209,
      "rmse_dx": 0.02156849578022957,
      "rmse_dy": 0.010196861810982227,
      "rmse_mean": 0.02723483368754387,
      "rotation_flip": 0.010676156729459763,
      "sparse_tokens": 9754.0,
      "step": 6868,
      "turn_loss": 0.24280816316604614,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.31913213157405684,
      "grad_norm": 0.4037987291812897,
      "learning_rate": 3.9397577053212925e-06,
      "loss": 0.1091,
      "mae_dtheta": 0.03193654865026474,
      "mae_dx": 0.011450733058154583,
      "mae_dy": 0.003428842406719923,
      "pose_mae_dtheta": 0.24871142208576202,
      "pose_mae_dx": 0.09388142079114914,
      "pose_mae_dy": 0.03647499904036522,
      "pose_rmse_dtheta": 0.4463904798030853,
      "pose_rmse_dx": 0.21844090521335602,
      "pose_rmse_dy": 0.09006285667419434,
      "pose_rmse_mean": 0.2516314387321472,
      "rmse_dtheta": 0.04971154406666756,
      "rmse_dx": 0.023506613448262215,
      "rmse_dy": 0.008448552340269089,
      "rmse_mean": 0.02722223661839962,
      "rotation_flip": 0.016710642725229263,
      "sparse_tokens": 18869.0,
      "step": 6869,
      "turn_loss": 0.25644227862358093,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.3191785913398996,
      "grad_norm": 0.5313977003097534,
      "learning_rate": 3.93846559166137e-06,
      "loss": 0.1263,
      "mae_dtheta": 0.03770934045314789,
      "mae_dx": 0.010554472915828228,
      "mae_dy": 0.006886801682412624,
      "pose_mae_dtheta": 0.2815436124801636,
      "pose_mae_dx": 0.08700922131538391,
      "pose_mae_dy": 0.08768971264362335,
      "pose_rmse_dtheta": 0.5141976475715637,
      "pose_rmse_dx": 0.2020106017589569,
      "pose_rmse_dy": 0.21141773462295532,
      "pose_rmse_mean": 0.3092086613178253,
      "rmse_dtheta": 0.05736546590924263,
      "rmse_dx": 0.023022590205073357,
      "rmse_dy": 0.014384827576577663,
      "rmse_mean": 0.031590960919857025,
      "rotation_flip": 0.011320754885673523,
      "sparse_tokens": 18649.0,
      "step": 6870,
      "turn_loss": 0.2503132224082947,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.31922505110574245,
      "grad_norm": 0.5389188528060913,
      "learning_rate": 3.937173552235117e-06,
      "loss": 0.1379,
      "mae_dtheta": 0.029717715457081795,
      "mae_dx": 0.01107112318277359,
      "mae_dy": 0.006103942170739174,
      "pose_mae_dtheta": 0.22921860218048096,
      "pose_mae_dx": 0.08967174589633942,
      "pose_mae_dy": 0.09864949434995651,
      "pose_rmse_dtheta": 0.402190238237381,
      "pose_rmse_dx": 0.21638721227645874,
      "pose_rmse_dy": 0.20169292390346527,
      "pose_rmse_mean": 0.2734234929084778,
      "rmse_dtheta": 0.04555195942521095,
      "rmse_dx": 0.025188151746988297,
      "rmse_dy": 0.01134102139621973,
      "rmse_mean": 0.027360377833247185,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 13590.0,
      "step": 6871,
      "turn_loss": 0.24598991870880127,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.31927151087158523,
      "grad_norm": 0.7913658618927002,
      "learning_rate": 3.935881587132889e-06,
      "loss": 0.1151,
      "mae_dtheta": 0.0263525303453207,
      "mae_dx": 0.005573989357799292,
      "mae_dy": 0.0032226541079580784,
      "pose_mae_dtheta": 0.21815218031406403,
      "pose_mae_dx": 0.039923377335071564,
      "pose_mae_dy": 0.041497476398944855,
      "pose_rmse_dtheta": 0.3589249551296234,
      "pose_rmse_dx": 0.1006682962179184,
      "pose_rmse_dy": 0.08872321248054504,
      "pose_rmse_mean": 0.18277215957641602,
      "rmse_dtheta": 0.04039571061730385,
      "rmse_dx": 0.014292202889919281,
      "rmse_dy": 0.006723881233483553,
      "rmse_mean": 0.020470598712563515,
      "rotation_flip": 0.006369426846504211,
      "sparse_tokens": 5647.0,
      "step": 6872,
      "turn_loss": 0.19447866082191467,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.319317970637428,
      "grad_norm": 0.40077483654022217,
      "learning_rate": 3.934589696445032e-06,
      "loss": 0.093,
      "mae_dtheta": 0.04050089046359062,
      "mae_dx": 0.013203038834035397,
      "mae_dy": 0.004354822915047407,
      "pose_mae_dtheta": 0.32457464933395386,
      "pose_mae_dx": 0.10102404654026031,
      "pose_mae_dy": 0.044548820704221725,
      "pose_rmse_dtheta": 0.5657851099967957,
      "pose_rmse_dx": 0.21381743252277374,
      "pose_rmse_dy": 0.1138267070055008,
      "pose_rmse_mean": 0.29780974984169006,
      "rmse_dtheta": 0.06026685610413551,
      "rmse_dx": 0.02548408880829811,
      "rmse_dy": 0.008755482733249664,
      "rmse_mean": 0.031502142548561096,
      "rotation_flip": 0.0117647061124444,
      "sparse_tokens": 6911.0,
      "step": 6873,
      "turn_loss": 0.2785284221172333,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3193644304032708,
      "grad_norm": 0.4489324688911438,
      "learning_rate": 3.933297880261892e-06,
      "loss": 0.0879,
      "mae_dtheta": 0.00607319688424468,
      "mae_dx": 0.0012948268558830023,
      "mae_dy": 0.0011580191785469651,
      "pose_mae_dtheta": 0.03817950189113617,
      "pose_mae_dx": 0.0133485933765769,
      "pose_mae_dy": 0.01432721596211195,
      "pose_rmse_dtheta": 0.07503726333379745,
      "pose_rmse_dx": 0.03013625368475914,
      "pose_rmse_dy": 0.032993532717227936,
      "pose_rmse_mean": 0.046055685728788376,
      "rmse_dtheta": 0.01411113515496254,
      "rmse_dx": 0.0035715587437152863,
      "rmse_dy": 0.0026859338395297527,
      "rmse_mean": 0.006789542734622955,
      "rotation_flip": 0.0013186812866479158,
      "sparse_tokens": 32121.0,
      "step": 6874,
      "turn_loss": 0.05322103202342987,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.31941089016911356,
      "grad_norm": 0.5300132036209106,
      "learning_rate": 3.932006138673801e-06,
      "loss": 0.1549,
      "mae_dtheta": 0.030938467010855675,
      "mae_dx": 0.010700809769332409,
      "mae_dy": 0.007568693254143,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5300130844116211,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.31430053710938,
      "model/head/act_norm_mean": 103.62962163880815,
      "model/head/act_norm_min": 64.04261779785156,
      "model/head/act_over_embed": 71.21524618599243,
      "model/head/grad_frac": 0.11560802161693573,
      "model/head/grad_norm": 0.061273764818906784,
      "model/head/grad_zero_frac": 0.00016815404524095356,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6909520348837209,
      "model/head/update_ratio": 0.0010452697752043605,
      "model/head/weight_delta": 9.34030818939209,
      "model/head/weight_delta_rel": 0.16385667026042938,
      "model/head/weight_norm": 58.62004852294922,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42160603404045105,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4215451587330211,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4214992821216583,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2896897796492874,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12072259932756424,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06398455798625946,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5469193892045454,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0020669978111982346,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0094213485717773,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09832717478275299,
      "model/modality_embedder.encoders.pose/weight_norm": 30.955310821533203,
      "model/modality_embedder/grad_frac": 0.12072259932756424,
      "model/modality_embedder/grad_norm": 0.06398455798625946,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5469193892045454,
      "model/modality_embedder/update_ratio": 0.0020669978111982346,
      "model/modality_embedder/weight_delta": 3.0094213485717773,
      "model/modality_embedder/weight_delta_rel": 0.09832717478275299,
      "model/modality_embedder/weight_norm": 30.955310821533203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.9587631225586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.142430324843115,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.299336433410645,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.90369478207847,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07080046087503433,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03752516955137253,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013451938284561038,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.440544605255127,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08893492072820663,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.895734786987305,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.34471893310547,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.95844868955334,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.850890159606934,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.46447024199163,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08004042506217957,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.042422473430633545,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001430270611308515,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.0931074619293213,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10714765638113022,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.660451889038086,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 73.5934829711914,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.64920173495755,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.201146125793457,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.626371563872805,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08366180211305618,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04434185102581978,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014478486264124513,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.338780641555786,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11211000382900238,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.626026153564453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 73.75261688232422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.58763612033961,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.806950569152832,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.958481821415997,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08778346329927444,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.046526383608579636,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001557828625664115,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8556525707244873,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09759265184402466,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.866174697875977,
      "model/normalizer/grad_frac": 0.320341020822525,
      "model/normalizer/grad_norm": 0.16978493332862854,
      "model/normalizer/grad_zero_frac": 0.00018435118545312434,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002161887474358082,
      "model/normalizer/weight_delta": 6.038751602172852,
      "model/normalizer/weight_delta_rel": 0.07777562737464905,
      "model/normalizer/weight_norm": 78.53550720214844,
      "pose_mae_dtheta": 0.23061290383338928,
      "pose_mae_dx": 0.08578374236822128,
      "pose_mae_dy": 0.07635637372732162,
      "pose_rmse_dtheta": 0.4357602000236511,
      "pose_rmse_dx": 0.1952139288187027,
      "pose_rmse_dy": 0.19376835227012634,
      "pose_rmse_mean": 0.2749141454696655,
      "rmse_dtheta": 0.04841702803969383,
      "rmse_dx": 0.02157231792807579,
      "rmse_dy": 0.0169929638504982,
      "rmse_mean": 0.028994103893637657,
      "rotation_flip": 0.014450866729021072,
      "sparse_tokens": 10813.0,
      "step": 6875,
      "turn_loss": 0.2934856116771698,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.31945734993495634,
      "grad_norm": 0.39088624715805054,
      "learning_rate": 3.930714471771096e-06,
      "loss": 0.1167,
      "mae_dtheta": 0.004898553714156151,
      "mae_dx": 0.0012192410649731755,
      "mae_dy": 0.0007662313291803002,
      "pose_mae_dtheta": 0.034371525049209595,
      "pose_mae_dx": 0.010999242775142193,
      "pose_mae_dy": 0.010169487446546555,
      "pose_rmse_dtheta": 0.10678708553314209,
      "pose_rmse_dx": 0.03094218485057354,
      "pose_rmse_dy": 0.03042948804795742,
      "pose_rmse_mean": 0.05605291947722435,
      "rmse_dtheta": 0.0160117968916893,
      "rmse_dx": 0.003718192456290126,
      "rmse_dy": 0.002946426859125495,
      "rmse_mean": 0.007558805402368307,
      "rotation_flip": 0.00283286115154624,
      "sparse_tokens": 32121.0,
      "step": 6876,
      "turn_loss": 0.04284866899251938,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.3195038097007991,
      "grad_norm": 0.5822698473930359,
      "learning_rate": 3.929422879644099e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.0411471351981163,
      "mae_dx": 0.012782402336597443,
      "mae_dy": 0.005692301783710718,
      "pose_mae_dtheta": 0.31681302189826965,
      "pose_mae_dx": 0.11441679298877716,
      "pose_mae_dy": 0.046674128621816635,
      "pose_rmse_dtheta": 0.5570483803749084,
      "pose_rmse_dx": 0.2173624038696289,
      "pose_rmse_dy": 0.12066351622343063,
      "pose_rmse_mean": 0.29835811257362366,
      "rmse_dtheta": 0.06203150749206543,
      "rmse_dx": 0.022577332332730293,
      "rmse_dy": 0.014000143855810165,
      "rmse_mean": 0.03286966308951378,
      "rotation_flip": 0.013615733943879604,
      "sparse_tokens": 11417.0,
      "step": 6877,
      "turn_loss": 0.2699755132198334,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.3195502694666419,
      "grad_norm": 0.4445301592350006,
      "learning_rate": 3.928131362383135e-06,
      "loss": 0.1241,
      "mae_dtheta": 0.02893109619617462,
      "mae_dx": 0.01222242508083582,
      "mae_dy": 0.005125976633280516,
      "pose_mae_dtheta": 0.222124382853508,
      "pose_mae_dx": 0.09951549768447876,
      "pose_mae_dy": 0.05786004662513733,
      "pose_rmse_dtheta": 0.3763475716114044,
      "pose_rmse_dx": 0.23800599575042725,
      "pose_rmse_dy": 0.144389808177948,
      "pose_rmse_mean": 0.2529144585132599,
      "rmse_dtheta": 0.04377777501940727,
      "rmse_dx": 0.025379255414009094,
      "rmse_dy": 0.0107161495834589,
      "rmse_mean": 0.026624394580721855,
      "rotation_flip": 0.01416765060275793,
      "sparse_tokens": 15203.0,
      "step": 6878,
      "turn_loss": 0.27519866824150085,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.31959672923248467,
      "grad_norm": 0.613061785697937,
      "learning_rate": 3.926839920078523e-06,
      "loss": 0.171,
      "mae_dtheta": 0.008681053295731544,
      "mae_dx": 0.0019406321225687861,
      "mae_dy": 0.0017148274928331375,
      "pose_mae_dtheta": 0.05858642980456352,
      "pose_mae_dx": 0.018743306398391724,
      "pose_mae_dy": 0.021953986957669258,
      "pose_rmse_dtheta": 0.2016071081161499,
      "pose_rmse_dx": 0.05418591573834419,
      "pose_rmse_dy": 0.08220001310110092,
      "pose_rmse_mean": 0.1126643568277359,
      "rmse_dtheta": 0.023291518911719322,
      "rmse_dx": 0.006794335320591927,
      "rmse_dy": 0.005373480264097452,
      "rmse_mean": 0.011819778941571712,
      "rotation_flip": 0.0015965938800945878,
      "sparse_tokens": 32057.0,
      "step": 6879,
      "turn_loss": 0.07698923349380493,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.31964318899832744,
      "grad_norm": 0.40470394492149353,
      "learning_rate": 3.925548552820568e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.01346671674400568,
      "mae_dx": 0.0036330758593976498,
      "mae_dy": 0.004363865591585636,
      "pose_mae_dtheta": 0.10274823009967804,
      "pose_mae_dx": 0.03821228817105293,
      "pose_mae_dy": 0.03039366379380226,
      "pose_rmse_dtheta": 0.2726278007030487,
      "pose_rmse_dx": 0.10217010229825974,
      "pose_rmse_dy": 0.07177203893661499,
      "pose_rmse_mean": 0.14885665476322174,
      "rmse_dtheta": 0.03050888143479824,
      "rmse_dx": 0.008869240060448647,
      "rmse_dy": 0.009980960749089718,
      "rmse_mean": 0.016453027725219727,
      "rotation_flip": 0.004479669034481049,
      "sparse_tokens": 32169.0,
      "step": 6880,
      "turn_loss": 0.1272965669631958,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3196896487641702,
      "grad_norm": 0.4160158932209015,
      "learning_rate": 3.924257260699583e-06,
      "loss": 0.0944,
      "mae_dtheta": 0.00536256842315197,
      "mae_dx": 0.0012309045996516943,
      "mae_dy": 0.0002634258707985282,
      "pose_mae_dtheta": 0.036767516285181046,
      "pose_mae_dx": 0.008936095982789993,
      "pose_mae_dy": 0.003939266782253981,
      "pose_rmse_dtheta": 0.1755528748035431,
      "pose_rmse_dx": 0.02234238013625145,
      "pose_rmse_dy": 0.00961392093449831,
      "pose_rmse_mean": 0.06916972994804382,
      "rmse_dtheta": 0.02306683361530304,
      "rmse_dx": 0.0036307922564446926,
      "rmse_dy": 0.0006278470391407609,
      "rmse_mean": 0.009108491241931915,
      "rotation_flip": 0.0,
      "sparse_tokens": 32153.0,
      "step": 6881,
      "turn_loss": 0.03844257816672325,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.319736108530013,
      "grad_norm": 0.7404117584228516,
      "learning_rate": 3.922966043805862e-06,
      "loss": 0.1606,
      "mae_dtheta": 0.03868752345442772,
      "mae_dx": 0.00978841818869114,
      "mae_dy": 0.005042791832238436,
      "pose_mae_dtheta": 0.31606850028038025,
      "pose_mae_dx": 0.0780755802989006,
      "pose_mae_dy": 0.0710478127002716,
      "pose_rmse_dtheta": 0.500530481338501,
      "pose_rmse_dx": 0.15767471492290497,
      "pose_rmse_dy": 0.18488812446594238,
      "pose_rmse_mean": 0.28103113174438477,
      "rmse_dtheta": 0.056837595999240875,
      "rmse_dx": 0.019935308024287224,
      "rmse_dy": 0.010631751269102097,
      "rmse_mean": 0.029134884476661682,
      "rotation_flip": 0.003267973894253373,
      "sparse_tokens": 10063.0,
      "step": 6882,
      "turn_loss": 0.26273640990257263,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3197825682958558,
      "grad_norm": 0.521589457988739,
      "learning_rate": 3.921674902229706e-06,
      "loss": 0.1658,
      "mae_dtheta": 0.00964204128831625,
      "mae_dx": 0.0012336608488112688,
      "mae_dy": 0.0017895142082124949,
      "pose_mae_dtheta": 0.0634845495223999,
      "pose_mae_dx": 0.017860982567071915,
      "pose_mae_dy": 0.02326796017587185,
      "pose_rmse_dtheta": 0.17404234409332275,
      "pose_rmse_dx": 0.043731026351451874,
      "pose_rmse_dy": 0.05449865385890007,
      "pose_rmse_mean": 0.0907573401927948,
      "rmse_dtheta": 0.02316453494131565,
      "rmse_dx": 0.0035279265139251947,
      "rmse_dy": 0.0036267531104385853,
      "rmse_mean": 0.01010640524327755,
      "rotation_flip": 0.0046747177839279175,
      "sparse_tokens": 32105.0,
      "step": 6883,
      "turn_loss": 0.07513901591300964,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.31982902806169855,
      "grad_norm": 0.6818298101425171,
      "learning_rate": 3.920383836061401e-06,
      "loss": 0.1841,
      "mae_dtheta": 0.0312810093164444,
      "mae_dx": 0.009742497466504574,
      "mae_dy": 0.004573941696435213,
      "pose_mae_dtheta": 0.24150711297988892,
      "pose_mae_dx": 0.08205126971006393,
      "pose_mae_dy": 0.05297118425369263,
      "pose_rmse_dtheta": 0.42639973759651184,
      "pose_rmse_dx": 0.1902073621749878,
      "pose_rmse_dy": 0.1170428991317749,
      "pose_rmse_mean": 0.24454998970031738,
      "rmse_dtheta": 0.04698853939771652,
      "rmse_dx": 0.021326284855604172,
      "rmse_dy": 0.008621562272310257,
      "rmse_mean": 0.025645460933446884,
      "rotation_flip": 0.01270289346575737,
      "sparse_tokens": 24495.0,
      "step": 6884,
      "turn_loss": 0.22994795441627502,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3198754878275413,
      "grad_norm": 0.41532063484191895,
      "learning_rate": 3.919092845391234e-06,
      "loss": 0.098,
      "mae_dtheta": 0.012527119368314743,
      "mae_dx": 0.0015877392143011093,
      "mae_dy": 0.0029167302418500185,
      "pose_mae_dtheta": 0.08451450616121292,
      "pose_mae_dx": 0.026030531153082848,
      "pose_mae_dy": 0.03185652941465378,
      "pose_rmse_dtheta": 0.22878247499465942,
      "pose_rmse_dx": 0.06297849118709564,
      "pose_rmse_dy": 0.07225978374481201,
      "pose_rmse_mean": 0.12134025990962982,
      "rmse_dtheta": 0.02731488272547722,
      "rmse_dx": 0.004544906318187714,
      "rmse_dy": 0.0059631504118442535,
      "rmse_mean": 0.012607647106051445,
      "rotation_flip": 0.0019105846295133233,
      "sparse_tokens": 32105.0,
      "step": 6885,
      "turn_loss": 0.09329762309789658,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3199219475933841,
      "grad_norm": 0.3981165587902069,
      "learning_rate": 3.917801930309486e-06,
      "loss": 0.0849,
      "mae_dtheta": 0.011453857645392418,
      "mae_dx": 0.0018450809875503182,
      "mae_dy": 0.0024230903945863247,
      "pose_mae_dtheta": 0.07689686119556427,
      "pose_mae_dx": 0.021218694746494293,
      "pose_mae_dy": 0.02947147935628891,
      "pose_rmse_dtheta": 0.1771136373281479,
      "pose_rmse_dx": 0.049864742904901505,
      "pose_rmse_dy": 0.058380961418151855,
      "pose_rmse_mean": 0.09511977434158325,
      "rmse_dtheta": 0.02188108116388321,
      "rmse_dx": 0.0055379620753228664,
      "rmse_dy": 0.004828431643545628,
      "rmse_mean": 0.010749159380793571,
      "rotation_flip": 0.008915834128856659,
      "sparse_tokens": 32105.0,
      "step": 6886,
      "turn_loss": 0.09617558866739273,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.31996840735922694,
      "grad_norm": 0.46242591738700867,
      "learning_rate": 3.9165110909064285e-06,
      "loss": 0.0589,
      "mae_dtheta": 0.006831308361142874,
      "mae_dx": 0.0012216708855703473,
      "mae_dy": 0.001080413581803441,
      "pose_mae_dtheta": 0.05290987342596054,
      "pose_mae_dx": 0.01081494428217411,
      "pose_mae_dy": 0.017013991251587868,
      "pose_rmse_dtheta": 0.14702129364013672,
      "pose_rmse_dx": 0.027342259883880615,
      "pose_rmse_dy": 0.03959543630480766,
      "pose_rmse_mean": 0.07131966948509216,
      "rmse_dtheta": 0.017920905724167824,
      "rmse_dx": 0.004030343145132065,
      "rmse_dy": 0.0021367836743593216,
      "rmse_mean": 0.008029344491660595,
      "rotation_flip": 0.0031562335789203644,
      "sparse_tokens": 32105.0,
      "step": 6887,
      "turn_loss": 0.0432412214577198,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3200148671250697,
      "grad_norm": 0.4030444622039795,
      "learning_rate": 3.915220327272333e-06,
      "loss": 0.0684,
      "mae_dtheta": 0.00632898136973381,
      "mae_dx": 0.0012127456720918417,
      "mae_dy": 0.0011650638189166784,
      "pose_mae_dtheta": 0.04364693537354469,
      "pose_mae_dx": 0.013344287872314453,
      "pose_mae_dy": 0.015043540857732296,
      "pose_rmse_dtheta": 0.15020982921123505,
      "pose_rmse_dx": 0.044633544981479645,
      "pose_rmse_dy": 0.04981166869401932,
      "pose_rmse_mean": 0.0815516859292984,
      "rmse_dtheta": 0.019483139738440514,
      "rmse_dx": 0.004392616916447878,
      "rmse_dy": 0.003175978548824787,
      "rmse_mean": 0.009017245844006538,
      "rotation_flip": 0.0012195121962577105,
      "sparse_tokens": 32057.0,
      "step": 6888,
      "turn_loss": 0.04366396740078926,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.3200613268909125,
      "grad_norm": 0.7268087267875671,
      "learning_rate": 3.913929639497462e-06,
      "loss": 0.2,
      "mae_dtheta": 0.036100272089242935,
      "mae_dx": 0.012267925776541233,
      "mae_dy": 0.0033927117474377155,
      "pose_mae_dtheta": 0.2800973355770111,
      "pose_mae_dx": 0.09793699532747269,
      "pose_mae_dy": 0.043022796511650085,
      "pose_rmse_dtheta": 0.5195817947387695,
      "pose_rmse_dx": 0.24430406093597412,
      "pose_rmse_dy": 0.10742830485105515,
      "pose_rmse_mean": 0.29043805599212646,
      "rmse_dtheta": 0.055289119482040405,
      "rmse_dx": 0.02595856413245201,
      "rmse_dy": 0.006528766825795174,
      "rmse_mean": 0.029258817434310913,
      "rotation_flip": 0.012016021646559238,
      "sparse_tokens": 12272.0,
      "step": 6889,
      "turn_loss": 0.2438313513994217,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.32010778665675527,
      "grad_norm": 0.38822290301322937,
      "learning_rate": 3.912639027672073e-06,
      "loss": 0.0791,
      "mae_dtheta": 0.010075452737510204,
      "mae_dx": 0.0010124967666342854,
      "mae_dy": 0.001841353252530098,
      "pose_mae_dtheta": 0.06692680716514587,
      "pose_mae_dx": 0.015654807910323143,
      "pose_mae_dy": 0.02478010207414627,
      "pose_rmse_dtheta": 0.19517046213150024,
      "pose_rmse_dx": 0.04894193634390831,
      "pose_rmse_dy": 0.056266382336616516,
      "pose_rmse_mean": 0.10012626647949219,
      "rmse_dtheta": 0.02294696681201458,
      "rmse_dx": 0.0032360509503632784,
      "rmse_dy": 0.004069986287504435,
      "rmse_mean": 0.010084334760904312,
      "rotation_flip": 0.0,
      "sparse_tokens": 32073.0,
      "step": 6890,
      "turn_loss": 0.0689273253083229,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.32015424642259804,
      "grad_norm": 0.6620574593544006,
      "learning_rate": 3.911348491886423e-06,
      "loss": 0.1396,
      "mae_dtheta": 0.03183294087648392,
      "mae_dx": 0.012394222430884838,
      "mae_dy": 0.006525182630866766,
      "pose_mae_dtheta": 0.26797816157341003,
      "pose_mae_dx": 0.08840496093034744,
      "pose_mae_dy": 0.09247986972332001,
      "pose_rmse_dtheta": 0.5251021385192871,
      "pose_rmse_dx": 0.19484877586364746,
      "pose_rmse_dy": 0.22902661561965942,
      "pose_rmse_mean": 0.316325843334198,
      "rmse_dtheta": 0.05190630629658699,
      "rmse_dx": 0.025934681296348572,
      "rmse_dy": 0.01454848051071167,
      "rmse_mean": 0.030796488747000694,
      "rotation_flip": 0.013550135307013988,
      "sparse_tokens": 13138.0,
      "step": 6891,
      "turn_loss": 0.2163996547460556,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.3202007061884408,
      "grad_norm": 1.3445063829421997,
      "learning_rate": 3.910058032230755e-06,
      "loss": 0.3172,
      "mae_dtheta": 0.040756821632385254,
      "mae_dx": 0.011524159461259842,
      "mae_dy": 0.0056403330527246,
      "pose_mae_dtheta": 0.3496129810810089,
      "pose_mae_dx": 0.08871442824602127,
      "pose_mae_dy": 0.06302885711193085,
      "pose_rmse_dtheta": 0.5638713836669922,
      "pose_rmse_dx": 0.21209430694580078,
      "pose_rmse_dy": 0.15864701569080353,
      "pose_rmse_mean": 0.31153756380081177,
      "rmse_dtheta": 0.05939453840255737,
      "rmse_dx": 0.02449977584183216,
      "rmse_dy": 0.011782868765294552,
      "rmse_mean": 0.03189239650964737,
      "rotation_flip": 0.01550387591123581,
      "sparse_tokens": 17408.0,
      "step": 6892,
      "turn_loss": 0.3559093475341797,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.3202471659542836,
      "grad_norm": 0.5910690426826477,
      "learning_rate": 3.908767648795315e-06,
      "loss": 0.086,
      "mae_dtheta": 0.023455139249563217,
      "mae_dx": 0.007977175526320934,
      "mae_dy": 0.004666992463171482,
      "pose_mae_dtheta": 0.17306889593601227,
      "pose_mae_dx": 0.06346729397773743,
      "pose_mae_dy": 0.04452415928244591,
      "pose_rmse_dtheta": 0.27422818541526794,
      "pose_rmse_dx": 0.11560245603322983,
      "pose_rmse_dy": 0.10960347950458527,
      "pose_rmse_mean": 0.16647803783416748,
      "rmse_dtheta": 0.035531580448150635,
      "rmse_dx": 0.015897929668426514,
      "rmse_dy": 0.009098438546061516,
      "rmse_mean": 0.020175984129309654,
      "rotation_flip": 0.024096384644508362,
      "sparse_tokens": 5557.0,
      "step": 6893,
      "turn_loss": 0.197120800614357,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.3202936257201264,
      "grad_norm": 0.3591289818286896,
      "learning_rate": 3.907477341670338e-06,
      "loss": 0.104,
      "mae_dtheta": 0.03573859855532646,
      "mae_dx": 0.010213805362582207,
      "mae_dy": 0.0057549322955310345,
      "pose_mae_dtheta": 0.28462815284729004,
      "pose_mae_dx": 0.07165180146694183,
      "pose_mae_dy": 0.06254130601882935,
      "pose_rmse_dtheta": 0.4526969790458679,
      "pose_rmse_dx": 0.1630479097366333,
      "pose_rmse_dy": 0.14442028105258942,
      "pose_rmse_mean": 0.2533884048461914,
      "rmse_dtheta": 0.05030246824026108,
      "rmse_dx": 0.021068571135401726,
      "rmse_dy": 0.01342645101249218,
      "rmse_mean": 0.028265831992030144,
      "rotation_flip": 0.02373417653143406,
      "sparse_tokens": 10292.0,
      "step": 6894,
      "turn_loss": 0.2899121046066284,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.32034008548596915,
      "grad_norm": 0.5245339870452881,
      "learning_rate": 3.906187110946058e-06,
      "loss": 0.0905,
      "mae_dtheta": 0.008252003230154514,
      "mae_dx": 0.001282240729779005,
      "mae_dy": 0.0014835103647783399,
      "pose_mae_dtheta": 0.054932110011577606,
      "pose_mae_dx": 0.016545958817005157,
      "pose_mae_dy": 0.02192891389131546,
      "pose_rmse_dtheta": 0.16030271351337433,
      "pose_rmse_dx": 0.05014096945524216,
      "pose_rmse_dy": 0.0592317096889019,
      "pose_rmse_mean": 0.08989179134368896,
      "rmse_dtheta": 0.020366698503494263,
      "rmse_dx": 0.004874753300100565,
      "rmse_dy": 0.003275267779827118,
      "rmse_mean": 0.00950557366013527,
      "rotation_flip": 0.005445544607937336,
      "sparse_tokens": 32025.0,
      "step": 6895,
      "turn_loss": 0.06553443521261215,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.3203865452518119,
      "grad_norm": 0.5905170440673828,
      "learning_rate": 3.904896956712699e-06,
      "loss": 0.1296,
      "mae_dtheta": 0.024317996576428413,
      "mae_dx": 0.012440484017133713,
      "mae_dy": 0.005425065755844116,
      "pose_mae_dtheta": 0.17307323217391968,
      "pose_mae_dx": 0.09312745928764343,
      "pose_mae_dy": 0.051156144589185715,
      "pose_rmse_dtheta": 0.2813292145729065,
      "pose_rmse_dx": 0.20202940702438354,
      "pose_rmse_dy": 0.0923047885298729,
      "pose_rmse_mean": 0.19188779592514038,
      "rmse_dtheta": 0.0372253879904747,
      "rmse_dx": 0.0231041070073843,
      "rmse_dy": 0.00925862044095993,
      "rmse_mean": 0.023196039721369743,
      "rotation_flip": 0.011428571306169033,
      "sparse_tokens": 4120.0,
      "step": 6896,
      "turn_loss": 0.23200909793376923,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.3204330050176547,
      "grad_norm": 0.6004313230514526,
      "learning_rate": 3.903606879060483e-06,
      "loss": 0.1692,
      "mae_dtheta": 0.03306390717625618,
      "mae_dx": 0.012966343201696873,
      "mae_dy": 0.005839552730321884,
      "pose_mae_dtheta": 0.25762391090393066,
      "pose_mae_dx": 0.0973244309425354,
      "pose_mae_dy": 0.09537681937217712,
      "pose_rmse_dtheta": 0.3792373836040497,
      "pose_rmse_dx": 0.2012322098016739,
      "pose_rmse_dy": 0.18037499487400055,
      "pose_rmse_mean": 0.2536148726940155,
      "rmse_dtheta": 0.04814467579126358,
      "rmse_dx": 0.025334587320685387,
      "rmse_dy": 0.009524863213300705,
      "rmse_mean": 0.027668043971061707,
      "rotation_flip": 0.02102803811430931,
      "sparse_tokens": 6416.0,
      "step": 6897,
      "turn_loss": 0.26751431822776794,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.3204794647834975,
      "grad_norm": 0.44922396540641785,
      "learning_rate": 3.902316878079629e-06,
      "loss": 0.091,
      "mae_dtheta": 0.030136479064822197,
      "mae_dx": 0.006648033391684294,
      "mae_dy": 0.0032615899108350277,
      "pose_mae_dtheta": 0.26574304699897766,
      "pose_mae_dx": 0.05266498029232025,
      "pose_mae_dy": 0.041445665061473846,
      "pose_rmse_dtheta": 0.5430881977081299,
      "pose_rmse_dx": 0.12672209739685059,
      "pose_rmse_dy": 0.09459437429904938,
      "pose_rmse_mean": 0.25480157136917114,
      "rmse_dtheta": 0.05228454992175102,
      "rmse_dx": 0.016314269974827766,
      "rmse_dy": 0.0068048578687012196,
      "rmse_mean": 0.025134561583399773,
      "rotation_flip": 0.003759398590773344,
      "sparse_tokens": 9938.0,
      "step": 6898,
      "turn_loss": 0.19349369406700134,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.32052592454934026,
      "grad_norm": 0.6174089908599854,
      "learning_rate": 3.901026953860343e-06,
      "loss": 0.1796,
      "mae_dtheta": 0.040143851190805435,
      "mae_dx": 0.02039969712495804,
      "mae_dy": 0.00843372754752636,
      "pose_mae_dtheta": 0.3436923623085022,
      "pose_mae_dx": 0.1786988526582718,
      "pose_mae_dy": 0.11124993115663528,
      "pose_rmse_dtheta": 0.5277055501937866,
      "pose_rmse_dx": 0.3231079876422882,
      "pose_rmse_dy": 0.22372101247310638,
      "pose_rmse_mean": 0.35817819833755493,
      "rmse_dtheta": 0.05535241216421127,
      "rmse_dx": 0.0334753580391407,
      "rmse_dy": 0.014998285099864006,
      "rmse_mean": 0.034608688205480576,
      "rotation_flip": 0.009630818851292133,
      "sparse_tokens": 20671.0,
      "step": 6899,
      "turn_loss": 0.4452829360961914,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.32057238431518303,
      "grad_norm": 0.76728355884552,
      "learning_rate": 3.899737106492833e-06,
      "loss": 0.1955,
      "mae_dtheta": 0.022510815411806107,
      "mae_dx": 0.010538003407418728,
      "mae_dy": 0.003596547758206725,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7672836780548096,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 132.73646545410156,
      "model/head/act_norm_mean": 108.7859375,
      "model/head/act_norm_min": 82.49241638183594,
      "model/head/act_over_embed": 74.75871471999314,
      "model/head/grad_frac": 0.11893853545188904,
      "model/head/grad_norm": 0.09125959873199463,
      "model/head/grad_zero_frac": 0.000162443146109581,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.702392578125,
      "model/head/update_ratio": 0.0015567430527880788,
      "model/head/weight_delta": 9.34975814819336,
      "model/head/weight_delta_rel": 0.16402244567871094,
      "model/head/weight_norm": 58.622135162353516,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4216090738773346,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4216090738773346,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4216090738773346,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2897337027348426,
      "model/modality_embedder.encoders.pose/grad_frac": 0.037697043269872665,
      "model/modality_embedder.encoders.pose/grad_norm": 0.028924325481057167,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009343719575554132,
      "model/modality_embedder.encoders.pose/weight_delta": 3.012190341949463,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09841764718294144,
      "model/modality_embedder.encoders.pose/weight_norm": 30.955900192260742,
      "model/modality_embedder/grad_frac": 0.037697043269872665,
      "model/modality_embedder/grad_norm": 0.028924325481057167,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0009343719575554132,
      "model/modality_embedder/weight_delta": 3.012190341949463,
      "model/modality_embedder/weight_delta_rel": 0.09841764718294144,
      "model/modality_embedder/weight_norm": 30.955900192260742,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.8660659790039,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.57566189236111,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.401816368103027,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.201415571254675,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.12441165745258331,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.09545903652906418,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.003421911271288991,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4441964626312256,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08906799554824829,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.89640998840332,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.26150512695312,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.374497767857143,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.552563667297363,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.750383063714843,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.12286579608917236,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0942729189991951,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0031782055739313364,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.098684549331665,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10734085738658905,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.662309646606445,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.97237396240234,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.959109933035716,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.78786563873291,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.839343378998386,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.1322782337665558,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.1014949306845665,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 9.0784378699027e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.003313822438940406,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.344417095184326,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11229926347732544,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.62775230407715,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 75.75961303710938,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.81381138392857,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.139799118041992,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.11391158004051,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.13543212413787842,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.10391485691070557,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0034791904035955667,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8608884811401367,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09777159243822098,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.86754035949707,
      "model/normalizer/grad_frac": 0.5592153072357178,
      "model/normalizer/grad_norm": 0.42907679080963135,
      "model/normalizer/grad_zero_frac": 0.00013708166079595685,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.005463350098580122,
      "model/normalizer/weight_delta": 6.049058437347412,
      "model/normalizer/weight_delta_rel": 0.07790836691856384,
      "model/normalizer/weight_norm": 78.53730773925781,
      "pose_mae_dtheta": 0.15721645951271057,
      "pose_mae_dx": 0.0764167308807373,
      "pose_mae_dy": 0.04403175786137581,
      "pose_rmse_dtheta": 0.28570055961608887,
      "pose_rmse_dx": 0.1919952929019928,
      "pose_rmse_dy": 0.09991148114204407,
      "pose_rmse_mean": 0.19253578782081604,
      "rmse_dtheta": 0.036254383623600006,
      "rmse_dx": 0.022540180012583733,
      "rmse_dy": 0.006712552160024643,
      "rmse_mean": 0.021835705265402794,
      "rotation_flip": 0.011111111380159855,
      "sparse_tokens": 5344.0,
      "step": 6900,
      "turn_loss": 0.21418924629688263,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 29522.0,
      "epoch": 0.3206188440810258,
      "grad_norm": 0.6735889315605164,
      "learning_rate": 3.898447336067297e-06,
      "loss": 0.2525,
      "mae_dtheta": 0.03615424782037735,
      "mae_dx": 0.012331987731158733,
      "mae_dy": 0.005385810509324074,
      "pose_mae_dtheta": 0.2797446846961975,
      "pose_mae_dx": 0.10609207302331924,
      "pose_mae_dy": 0.06278292089700699,
      "pose_rmse_dtheta": 0.4980257451534271,
      "pose_rmse_dx": 0.2220398336648941,
      "pose_rmse_dy": 0.15252037346363068,
      "pose_rmse_mean": 0.29086199402809143,
      "rmse_dtheta": 0.05418578162789345,
      "rmse_dx": 0.02424975112080574,
      "rmse_dy": 0.010066180489957333,
      "rmse_mean": 0.029500572010874748,
      "rotation_flip": 0.011196641251444817,
      "sparse_tokens": 23838.0,
      "step": 6901,
      "turn_loss": 0.2723098695278168,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.3206653038468686,
      "grad_norm": 0.6210760474205017,
      "learning_rate": 3.897157642673932e-06,
      "loss": 0.1849,
      "mae_dtheta": 0.029026063159108162,
      "mae_dx": 0.015211829915642738,
      "mae_dy": 0.004467210732400417,
      "pose_mae_dtheta": 0.23624737560749054,
      "pose_mae_dx": 0.11433856934309006,
      "pose_mae_dy": 0.050660569220781326,
      "pose_rmse_dtheta": 0.38730064034461975,
      "pose_rmse_dx": 0.23497024178504944,
      "pose_rmse_dy": 0.13532812893390656,
      "pose_rmse_mean": 0.2525330185890198,
      "rmse_dtheta": 0.0427386611700058,
      "rmse_dx": 0.02841154672205448,
      "rmse_dy": 0.009379850700497627,
      "rmse_mean": 0.026843352243304253,
      "rotation_flip": 0.009032257832586765,
      "sparse_tokens": 12406.0,
      "step": 6902,
      "turn_loss": 0.253549724817276,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.32071176361271136,
      "grad_norm": 0.3709481358528137,
      "learning_rate": 3.895868026402922e-06,
      "loss": 0.0939,
      "mae_dtheta": 0.01020787749439478,
      "mae_dx": 0.002601392101496458,
      "mae_dy": 0.003290539840236306,
      "pose_mae_dtheta": 0.06209834665060043,
      "pose_mae_dx": 0.028055286034941673,
      "pose_mae_dy": 0.029013127088546753,
      "pose_rmse_dtheta": 0.11834341287612915,
      "pose_rmse_dx": 0.08757250010967255,
      "pose_rmse_dy": 0.06565909832715988,
      "pose_rmse_mean": 0.09052500128746033,
      "rmse_dtheta": 0.01964542828500271,
      "rmse_dx": 0.008321345783770084,
      "rmse_dy": 0.008445019833743572,
      "rmse_mean": 0.012137265875935555,
      "rotation_flip": 0.002358490601181984,
      "sparse_tokens": 32121.0,
      "step": 6903,
      "turn_loss": 0.09780245274305344,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.3207582233785542,
      "grad_norm": 0.6832818984985352,
      "learning_rate": 3.894578487344454e-06,
      "loss": 0.2021,
      "mae_dtheta": 0.03837292641401291,
      "mae_dx": 0.016989080235362053,
      "mae_dy": 0.003902976168319583,
      "pose_mae_dtheta": 0.35203543305397034,
      "pose_mae_dx": 0.14600703120231628,
      "pose_mae_dy": 0.053636834025382996,
      "pose_rmse_dtheta": 0.5510033965110779,
      "pose_rmse_dx": 0.2846212685108185,
      "pose_rmse_dy": 0.14981989562511444,
      "pose_rmse_mean": 0.3284815549850464,
      "rmse_dtheta": 0.05443466082215309,
      "rmse_dx": 0.02993800677359104,
      "rmse_dy": 0.008571362122893333,
      "rmse_mean": 0.03098134510219097,
      "rotation_flip": 0.010660980828106403,
      "sparse_tokens": 15765.0,
      "step": 6904,
      "turn_loss": 0.29161202907562256,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.320804683144397,
      "grad_norm": 0.6172224879264832,
      "learning_rate": 3.893289025588708e-06,
      "loss": 0.164,
      "mae_dtheta": 0.026440486311912537,
      "mae_dx": 0.01010340079665184,
      "mae_dy": 0.003891473403200507,
      "pose_mae_dtheta": 0.21465949714183807,
      "pose_mae_dx": 0.07249120622873306,
      "pose_mae_dy": 0.048852913081645966,
      "pose_rmse_dtheta": 0.4039674699306488,
      "pose_rmse_dx": 0.1823289841413498,
      "pose_rmse_dy": 0.12966938316822052,
      "pose_rmse_mean": 0.23865526914596558,
      "rmse_dtheta": 0.04539838433265686,
      "rmse_dx": 0.023121308535337448,
      "rmse_dy": 0.007752823177725077,
      "rmse_mean": 0.0254241731017828,
      "rotation_flip": 0.007352941203862429,
      "sparse_tokens": 20522.0,
      "step": 6905,
      "turn_loss": 0.20518480241298676,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.32085114291023975,
      "grad_norm": 0.35197967290878296,
      "learning_rate": 3.891999641225852e-06,
      "loss": 0.0815,
      "mae_dtheta": 0.006741872988641262,
      "mae_dx": 0.0010143894469365478,
      "mae_dy": 0.0010974595788866282,
      "pose_mae_dtheta": 0.049226969480514526,
      "pose_mae_dx": 0.01289561577141285,
      "pose_mae_dy": 0.01749539002776146,
      "pose_rmse_dtheta": 0.1649390608072281,
      "pose_rmse_dx": 0.039123110473155975,
      "pose_rmse_dy": 0.04746388643980026,
      "pose_rmse_mean": 0.08384202420711517,
      "rmse_dtheta": 0.01813887059688568,
      "rmse_dx": 0.0035986730363219976,
      "rmse_dy": 0.002834429731592536,
      "rmse_mean": 0.008190657943487167,
      "rotation_flip": 0.0015120967291295528,
      "sparse_tokens": 32089.0,
      "step": 6906,
      "turn_loss": 0.04780343547463417,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3208976026760825,
      "grad_norm": 0.43290790915489197,
      "learning_rate": 3.890710334346058e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.012050514109432697,
      "mae_dx": 0.0019232014892622828,
      "mae_dy": 0.003062176052480936,
      "pose_mae_dtheta": 0.07843442261219025,
      "pose_mae_dx": 0.026099391281604767,
      "pose_mae_dy": 0.03441376984119415,
      "pose_rmse_dtheta": 0.14972542226314545,
      "pose_rmse_dx": 0.0587313175201416,
      "pose_rmse_dy": 0.06716159731149673,
      "pose_rmse_mean": 0.09187278151512146,
      "rmse_dtheta": 0.021770566701889038,
      "rmse_dx": 0.005892787594348192,
      "rmse_dy": 0.006345356814563274,
      "rmse_mean": 0.01133623719215393,
      "rotation_flip": 0.005764563102275133,
      "sparse_tokens": 32121.0,
      "step": 6907,
      "turn_loss": 0.10027236491441727,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.3209440624419253,
      "grad_norm": 0.5042896866798401,
      "learning_rate": 3.889421105039485e-06,
      "loss": 0.133,
      "mae_dtheta": 0.032199881970882416,
      "mae_dx": 0.010868201032280922,
      "mae_dy": 0.007269248832017183,
      "pose_mae_dtheta": 0.2535531520843506,
      "pose_mae_dx": 0.10166696459054947,
      "pose_mae_dy": 0.0896853432059288,
      "pose_rmse_dtheta": 0.4424036741256714,
      "pose_rmse_dx": 0.23872336745262146,
      "pose_rmse_dy": 0.22661539912223816,
      "pose_rmse_mean": 0.3025808334350586,
      "rmse_dtheta": 0.048449646681547165,
      "rmse_dx": 0.02372572384774685,
      "rmse_dy": 0.01461170706897974,
      "rmse_mean": 0.028929024934768677,
      "rotation_flip": 0.013432836160063744,
      "sparse_tokens": 24331.0,
      "step": 6908,
      "turn_loss": 0.30914637446403503,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3209905222077681,
      "grad_norm": 0.44871172308921814,
      "learning_rate": 3.888131953396288e-06,
      "loss": 0.0773,
      "mae_dtheta": 0.008681648410856724,
      "mae_dx": 0.0017064254498109221,
      "mae_dy": 0.001129988464526832,
      "pose_mae_dtheta": 0.06203553080558777,
      "pose_mae_dx": 0.01710330881178379,
      "pose_mae_dy": 0.015368365682661533,
      "pose_rmse_dtheta": 0.20582471787929535,
      "pose_rmse_dx": 0.04893447458744049,
      "pose_rmse_dy": 0.0357380136847496,
      "pose_rmse_mean": 0.09683240950107574,
      "rmse_dtheta": 0.02422294393181801,
      "rmse_dx": 0.00573496799916029,
      "rmse_dy": 0.0024434146471321583,
      "rmse_mean": 0.010800442658364773,
      "rotation_flip": 0.0005293806316331029,
      "sparse_tokens": 32121.0,
      "step": 6909,
      "turn_loss": 0.06038719415664673,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.32103698197361086,
      "grad_norm": 0.6986920833587646,
      "learning_rate": 3.886842879506623e-06,
      "loss": 0.1944,
      "mae_dtheta": 0.008159615099430084,
      "mae_dx": 0.002349601127207279,
      "mae_dy": 0.0015969076193869114,
      "pose_mae_dtheta": 0.05524222180247307,
      "pose_mae_dx": 0.018296286463737488,
      "pose_mae_dy": 0.019254157319664955,
      "pose_rmse_dtheta": 0.1495361328125,
      "pose_rmse_dx": 0.05260859429836273,
      "pose_rmse_dy": 0.06053831800818443,
      "pose_rmse_mean": 0.08756101131439209,
      "rmse_dtheta": 0.020868485793471336,
      "rmse_dx": 0.007484337314963341,
      "rmse_dy": 0.004733913578093052,
      "rmse_mean": 0.011028911918401718,
      "rotation_flip": 0.005960568320006132,
      "sparse_tokens": 32185.0,
      "step": 6910,
      "turn_loss": 0.08104875683784485,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.32108344173945363,
      "grad_norm": 0.39774656295776367,
      "learning_rate": 3.885553883460631e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.009024852886795998,
      "mae_dx": 0.0019869280513375998,
      "mae_dy": 0.002291949698701501,
      "pose_mae_dtheta": 0.06521881371736526,
      "pose_mae_dx": 0.024782810360193253,
      "pose_mae_dy": 0.02748975344002247,
      "pose_rmse_dtheta": 0.19789674878120422,
      "pose_rmse_dx": 0.06822118908166885,
      "pose_rmse_dy": 0.07315175980329514,
      "pose_rmse_mean": 0.1130899041891098,
      "rmse_dtheta": 0.021989209577441216,
      "rmse_dx": 0.0061513762921094894,
      "rmse_dy": 0.005862855818122625,
      "rmse_mean": 0.011334480717778206,
      "rotation_flip": 0.003070175414904952,
      "sparse_tokens": 32073.0,
      "step": 6911,
      "turn_loss": 0.0755305364727974,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3211299015052964,
      "grad_norm": 0.36270883679389954,
      "learning_rate": 3.884264965348457e-06,
      "loss": 0.0666,
      "mae_dtheta": 0.010474162176251411,
      "mae_dx": 0.0015865672612562776,
      "mae_dy": 0.0029816508758813143,
      "pose_mae_dtheta": 0.063217893242836,
      "pose_mae_dx": 0.025727897882461548,
      "pose_mae_dy": 0.03010491654276848,
      "pose_rmse_dtheta": 0.16663387417793274,
      "pose_rmse_dx": 0.0691726952791214,
      "pose_rmse_dy": 0.0861244797706604,
      "pose_rmse_mean": 0.10731035470962524,
      "rmse_dtheta": 0.0238343495875597,
      "rmse_dx": 0.0037087067030370235,
      "rmse_dy": 0.007110191509127617,
      "rmse_mean": 0.011551082134246826,
      "rotation_flip": 0.01047542318701744,
      "sparse_tokens": 32105.0,
      "step": 6912,
      "turn_loss": 0.09117958694696426,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.3211763612711392,
      "grad_norm": 0.42851120233535767,
      "learning_rate": 3.882976125260229e-06,
      "loss": 0.0802,
      "mae_dtheta": 0.026911303400993347,
      "mae_dx": 0.0051056938245892525,
      "mae_dy": 0.006074936129152775,
      "pose_mae_dtheta": 0.20896084606647491,
      "pose_mae_dx": 0.04976639896631241,
      "pose_mae_dy": 0.09262022376060486,
      "pose_rmse_dtheta": 0.3693046271800995,
      "pose_rmse_dx": 0.11798287183046341,
      "pose_rmse_dy": 0.20987153053283691,
      "pose_rmse_mean": 0.23238635063171387,
      "rmse_dtheta": 0.04376307502388954,
      "rmse_dx": 0.012996427714824677,
      "rmse_dy": 0.012071124278008938,
      "rmse_mean": 0.022943541407585144,
      "rotation_flip": 0.005797101650387049,
      "sparse_tokens": 7303.0,
      "step": 6913,
      "turn_loss": 0.21112585067749023,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.32122282103698196,
      "grad_norm": 0.5131346583366394,
      "learning_rate": 3.881687363286083e-06,
      "loss": 0.1272,
      "mae_dtheta": 0.010200166143476963,
      "mae_dx": 0.0023337467573583126,
      "mae_dy": 0.002433035522699356,
      "pose_mae_dtheta": 0.07235457748174667,
      "pose_mae_dx": 0.021171368658542633,
      "pose_mae_dy": 0.02685149572789669,
      "pose_rmse_dtheta": 0.16864481568336487,
      "pose_rmse_dx": 0.05464162677526474,
      "pose_rmse_dy": 0.06385806202888489,
      "pose_rmse_mean": 0.09571483731269836,
      "rmse_dtheta": 0.021712953224778175,
      "rmse_dx": 0.008141969330608845,
      "rmse_dy": 0.006790060084313154,
      "rmse_mean": 0.012214994989335537,
      "rotation_flip": 0.00513022905215621,
      "sparse_tokens": 32121.0,
      "step": 6914,
      "turn_loss": 0.09985773265361786,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.32126928080282474,
      "grad_norm": 0.6126176714897156,
      "learning_rate": 3.880398679516139e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.03228307142853737,
      "mae_dx": 0.01307305321097374,
      "mae_dy": 0.004073370713740587,
      "pose_mae_dtheta": 0.28034162521362305,
      "pose_mae_dx": 0.10214409232139587,
      "pose_mae_dy": 0.050375714898109436,
      "pose_rmse_dtheta": 0.5234029293060303,
      "pose_rmse_dx": 0.23545701801776886,
      "pose_rmse_dy": 0.15070199966430664,
      "pose_rmse_mean": 0.3031873106956482,
      "rmse_dtheta": 0.050759267061948776,
      "rmse_dx": 0.026263762265443802,
      "rmse_dy": 0.00821971520781517,
      "rmse_mean": 0.028414249420166016,
      "rotation_flip": 0.013400334864854813,
      "sparse_tokens": 10888.0,
      "step": 6915,
      "turn_loss": 0.22626811265945435,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3213157405686675,
      "grad_norm": 0.3236238360404968,
      "learning_rate": 3.879110074040515e-06,
      "loss": 0.0824,
      "mae_dtheta": 0.007875029928982258,
      "mae_dx": 0.001547094900161028,
      "mae_dy": 0.0019272001227363944,
      "pose_mae_dtheta": 0.05922888591885567,
      "pose_mae_dx": 0.014953884296119213,
      "pose_mae_dy": 0.02146386168897152,
      "pose_rmse_dtheta": 0.1756921410560608,
      "pose_rmse_dx": 0.052841074764728546,
      "pose_rmse_dy": 0.06396441161632538,
      "pose_rmse_mean": 0.09749921411275864,
      "rmse_dtheta": 0.020721647888422012,
      "rmse_dx": 0.005687115713953972,
      "rmse_dy": 0.006876015570014715,
      "rmse_mean": 0.011094926856458187,
      "rotation_flip": 0.0028341992292553186,
      "sparse_tokens": 32105.0,
      "step": 6916,
      "turn_loss": 0.07249943912029266,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3213622003345103,
      "grad_norm": 0.6151925921440125,
      "learning_rate": 3.877821546949327e-06,
      "loss": 0.0864,
      "mae_dtheta": 0.01250425260514021,
      "mae_dx": 0.0024385249707847834,
      "mae_dy": 0.0037874197587370872,
      "pose_mae_dtheta": 0.09184350073337555,
      "pose_mae_dx": 0.036256469786167145,
      "pose_mae_dy": 0.03636883571743965,
      "pose_rmse_dtheta": 0.19505548477172852,
      "pose_rmse_dx": 0.11115394532680511,
      "pose_rmse_dy": 0.08152161538600922,
      "pose_rmse_mean": 0.12924370169639587,
      "rmse_dtheta": 0.02461092732846737,
      "rmse_dx": 0.006634716875851154,
      "rmse_dy": 0.00853744987398386,
      "rmse_mean": 0.013261031359434128,
      "rotation_flip": 0.006642311345785856,
      "sparse_tokens": 32105.0,
      "step": 6917,
      "turn_loss": 0.10498994588851929,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.32140866010035307,
      "grad_norm": 0.575765073299408,
      "learning_rate": 3.876533098332679e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.005723327398300171,
      "mae_dx": 0.00128902867436409,
      "mae_dy": 0.0008949779439717531,
      "pose_mae_dtheta": 0.035666465759277344,
      "pose_mae_dx": 0.010733741335570812,
      "pose_mae_dy": 0.010914254002273083,
      "pose_rmse_dtheta": 0.15986651182174683,
      "pose_rmse_dx": 0.033378370106220245,
      "pose_rmse_dy": 0.02908969298005104,
      "pose_rmse_mean": 0.07411152124404907,
      "rmse_dtheta": 0.020002346485853195,
      "rmse_dx": 0.004545310046523809,
      "rmse_dy": 0.0028284830041229725,
      "rmse_mean": 0.009125379845499992,
      "rotation_flip": 0.006125574465841055,
      "sparse_tokens": 32057.0,
      "step": 6918,
      "turn_loss": 0.03451555594801903,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.32145511986619585,
      "grad_norm": 0.5403782725334167,
      "learning_rate": 3.875244728280676e-06,
      "loss": 0.1317,
      "mae_dtheta": 0.0365428701043129,
      "mae_dx": 0.010008315555751324,
      "mae_dy": 0.005586291663348675,
      "pose_mae_dtheta": 0.2842482030391693,
      "pose_mae_dx": 0.09440206736326218,
      "pose_mae_dy": 0.08400270342826843,
      "pose_rmse_dtheta": 0.47871848940849304,
      "pose_rmse_dx": 0.21703693270683289,
      "pose_rmse_dy": 0.17051002383232117,
      "pose_rmse_mean": 0.2887551486492157,
      "rmse_dtheta": 0.053954117000103,
      "rmse_dx": 0.022729959338903427,
      "rmse_dy": 0.009318013675510883,
      "rmse_mean": 0.02866736426949501,
      "rotation_flip": 0.01567944325506687,
      "sparse_tokens": 20462.0,
      "step": 6919,
      "turn_loss": 0.2464311569929123,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3215015796320387,
      "grad_norm": 0.4834892153739929,
      "learning_rate": 3.873956436883412e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.009184363298118114,
      "mae_dx": 0.0012366320006549358,
      "mae_dy": 0.0023658117279410362,
      "pose_mae_dtheta": 0.0601695217192173,
      "pose_mae_dx": 0.022640952840447426,
      "pose_mae_dy": 0.029015399515628815,
      "pose_rmse_dtheta": 0.1377871185541153,
      "pose_rmse_dx": 0.06165288761258125,
      "pose_rmse_dy": 0.06932248920202255,
      "pose_rmse_mean": 0.08958750218153,
      "rmse_dtheta": 0.01878420077264309,
      "rmse_dx": 0.00324964988976717,
      "rmse_dy": 0.005272437818348408,
      "rmse_mean": 0.009102096781134605,
      "rotation_flip": 0.004683840554207563,
      "sparse_tokens": 32073.0,
      "step": 6920,
      "turn_loss": 0.05847853422164917,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.32154803939788146,
      "grad_norm": 0.4967747926712036,
      "learning_rate": 3.872668224230979e-06,
      "loss": 0.1847,
      "mae_dtheta": 0.03771338239312172,
      "mae_dx": 0.013058798387646675,
      "mae_dy": 0.007106131408363581,
      "pose_mae_dtheta": 0.3160306513309479,
      "pose_mae_dx": 0.10922344774007797,
      "pose_mae_dy": 0.0725967288017273,
      "pose_rmse_dtheta": 0.5260360240936279,
      "pose_rmse_dx": 0.22733554244041443,
      "pose_rmse_dy": 0.16271449625492096,
      "pose_rmse_mean": 0.3053620457649231,
      "rmse_dtheta": 0.055361393839120865,
      "rmse_dx": 0.025098226964473724,
      "rmse_dy": 0.013109714724123478,
      "rmse_mean": 0.031189780682325363,
      "rotation_flip": 0.015713388100266457,
      "sparse_tokens": 28188.0,
      "step": 6921,
      "turn_loss": 0.3168543875217438,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.32159449916372423,
      "grad_norm": 0.5826295018196106,
      "learning_rate": 3.871380090413462e-06,
      "loss": 0.1544,
      "mae_dtheta": 0.039779938757419586,
      "mae_dx": 0.00994490459561348,
      "mae_dy": 0.007156267762184143,
      "pose_mae_dtheta": 0.29199180006980896,
      "pose_mae_dx": 0.08457019925117493,
      "pose_mae_dy": 0.09409089386463165,
      "pose_rmse_dtheta": 0.4893908202648163,
      "pose_rmse_dx": 0.19079633057117462,
      "pose_rmse_dy": 0.22700001299381256,
      "pose_rmse_mean": 0.3023957312107086,
      "rmse_dtheta": 0.05614424869418144,
      "rmse_dx": 0.022259755060076714,
      "rmse_dy": 0.014727809466421604,
      "rmse_mean": 0.03104393742978573,
      "rotation_flip": 0.01542111486196518,
      "sparse_tokens": 13887.0,
      "step": 6922,
      "turn_loss": 0.3335556089878082,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.321640958929567,
      "grad_norm": 0.4826878309249878,
      "learning_rate": 3.870092035520939e-06,
      "loss": 0.0758,
      "mae_dtheta": 0.010358915664255619,
      "mae_dx": 0.0015146455261856318,
      "mae_dy": 0.0019457857124507427,
      "pose_mae_dtheta": 0.0677848532795906,
      "pose_mae_dx": 0.018743040040135384,
      "pose_mae_dy": 0.022982792928814888,
      "pose_rmse_dtheta": 0.21291270852088928,
      "pose_rmse_dx": 0.04802469536662102,
      "pose_rmse_dy": 0.06066100299358368,
      "pose_rmse_mean": 0.10719947516918182,
      "rmse_dtheta": 0.027139270678162575,
      "rmse_dx": 0.0047844815999269485,
      "rmse_dy": 0.00537904305383563,
      "rmse_mean": 0.012434265576303005,
      "rotation_flip": 0.012969588860869408,
      "sparse_tokens": 32105.0,
      "step": 6923,
      "turn_loss": 0.06666092574596405,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.3216874186954098,
      "grad_norm": 0.4608396887779236,
      "learning_rate": 3.86880405964349e-06,
      "loss": 0.1136,
      "mae_dtheta": 0.04370037093758583,
      "mae_dx": 0.012815636582672596,
      "mae_dy": 0.003011589404195547,
      "pose_mae_dtheta": 0.3596835434436798,
      "pose_mae_dx": 0.10496653616428375,
      "pose_mae_dy": 0.046517204493284225,
      "pose_rmse_dtheta": 0.5887642502784729,
      "pose_rmse_dx": 0.23380787670612335,
      "pose_rmse_dy": 0.10671621561050415,
      "pose_rmse_mean": 0.30976277589797974,
      "rmse_dtheta": 0.06324867159128189,
      "rmse_dx": 0.02574109472334385,
      "rmse_dy": 0.006184247322380543,
      "rmse_mean": 0.03172467276453972,
      "rotation_flip": 0.01702127605676651,
      "sparse_tokens": 13069.0,
      "step": 6924,
      "turn_loss": 0.2544235587120056,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.32173387846125256,
      "grad_norm": 0.8112538456916809,
      "learning_rate": 3.867516162871177e-06,
      "loss": 0.1659,
      "mae_dtheta": 0.019607938826084137,
      "mae_dx": 0.014202331192791462,
      "mae_dy": 0.0023059160448610783,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8112539649009705,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 148.58413696289062,
      "model/head/act_norm_mean": 112.00904947916666,
      "model/head/act_norm_min": 84.61534118652344,
      "model/head/act_over_embed": 76.97366744732624,
      "model/head/grad_frac": 0.08994947373867035,
      "model/head/grad_norm": 0.07297186553478241,
      "model/head/grad_zero_frac": 0.00014784865197725594,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6891276041666666,
      "model/head/update_ratio": 0.0012447418412193656,
      "model/head/weight_delta": 9.359232902526855,
      "model/head/weight_delta_rel": 0.1641886681318283,
      "model/head/weight_norm": 58.62409591674805,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4216935932636261,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4216485917568207,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4215744733810425,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28976085979159766,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1088123470544815,
      "model/modality_embedder.encoders.pose/grad_norm": 0.08827444911003113,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5531005859375,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0028516023885458708,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0157368183135986,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0985335186123848,
      "model/modality_embedder.encoders.pose/weight_norm": 30.956087112426758,
      "model/modality_embedder/grad_frac": 0.1088123470544815,
      "model/modality_embedder/grad_norm": 0.08827444911003113,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5531005859375,
      "model/modality_embedder/update_ratio": 0.0028516023885458708,
      "model/modality_embedder/weight_delta": 3.0157368183135986,
      "model/modality_embedder/weight_delta_rel": 0.0985335186123848,
      "model/modality_embedder/weight_norm": 30.956087112426758,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 76.19930267333984,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.882103587962963,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.307191848754883,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.41200517342462,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06897114217281342,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05595311522483826,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020056837238371372,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4479966163635254,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08920647203922272,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.897275924682617,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 77.47367095947266,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.757355737433862,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.818910598754883,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.01348664478075,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07506478577852249,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.060896605253219604,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0020528763998299837,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1037275791168213,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10751555114984512,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.664037704467773,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.0990219116211,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.340447255291004,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.058380126953125,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.10140195698848,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07229858636856079,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05865251645445824,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019149098079651594,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.3499348163604736,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11248453706502914,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.6293888092041,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 80.150390625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.152612433862434,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.869166374206543,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.346738833460467,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06699635088443756,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05435105413198471,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018196281744167209,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.866264820098877,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09795533120632172,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.86931800842285,
      "model/normalizer/grad_frac": 0.25665387511253357,
      "model/normalizer/grad_norm": 0.2082114815711975,
      "model/normalizer/grad_zero_frac": 0.00015126251673791558,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00265104859136045,
      "model/normalizer/weight_delta": 6.059267520904541,
      "model/normalizer/weight_delta_rel": 0.07803985476493835,
      "model/normalizer/weight_norm": 78.53929138183594,
      "pose_mae_dtheta": 0.19425638020038605,
      "pose_mae_dx": 0.10329841077327728,
      "pose_mae_dy": 0.03362705931067467,
      "pose_rmse_dtheta": 0.2923390865325928,
      "pose_rmse_dx": 0.21550194919109344,
      "pose_rmse_dy": 0.07357797026634216,
      "pose_rmse_mean": 0.19380633533000946,
      "rmse_dtheta": 0.031029993668198586,
      "rmse_dx": 0.02474043145775795,
      "rmse_dy": 0.0038972864858806133,
      "rmse_mean": 0.019889239221811295,
      "rotation_flip": 0.0057142856530845165,
      "sparse_tokens": 3898.0,
      "step": 6925,
      "turn_loss": 0.18043732643127441,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.32178033822709534,
      "grad_norm": 0.47725725173950195,
      "learning_rate": 3.8662283452940705e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.05647318437695503,
      "mae_dx": 0.015902699902653694,
      "mae_dy": 0.00549161434173584,
      "pose_mae_dtheta": 0.45761093497276306,
      "pose_mae_dx": 0.13888536393642426,
      "pose_mae_dy": 0.08359009027481079,
      "pose_rmse_dtheta": 0.7194979190826416,
      "pose_rmse_dx": 0.2587341368198395,
      "pose_rmse_dy": 0.1543264389038086,
      "pose_rmse_mean": 0.37751948833465576,
      "rmse_dtheta": 0.07428116351366043,
      "rmse_dx": 0.028575684875249863,
      "rmse_dy": 0.012049191631376743,
      "rmse_mean": 0.03830201178789139,
      "rotation_flip": 0.009433962404727936,
      "sparse_tokens": 3432.0,
      "step": 6926,
      "turn_loss": 0.34759584069252014,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3218267979929381,
      "grad_norm": 0.43533793091773987,
      "learning_rate": 3.864940607002222e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.0062753441743552685,
      "mae_dx": 0.0013744047610089183,
      "mae_dy": 0.0008187218918465078,
      "pose_mae_dtheta": 0.04589899629354477,
      "pose_mae_dx": 0.01372016966342926,
      "pose_mae_dy": 0.011772148311138153,
      "pose_rmse_dtheta": 0.1699754148721695,
      "pose_rmse_dx": 0.042268313467502594,
      "pose_rmse_dy": 0.031104987487196922,
      "pose_rmse_mean": 0.08111624419689178,
      "rmse_dtheta": 0.020896999165415764,
      "rmse_dx": 0.00518618943169713,
      "rmse_dy": 0.0020253905095160007,
      "rmse_mean": 0.00936952605843544,
      "rotation_flip": 0.00413223123177886,
      "sparse_tokens": 32089.0,
      "step": 6927,
      "turn_loss": 0.04376308247447014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3218732577587809,
      "grad_norm": 0.40492895245552063,
      "learning_rate": 3.863652948085686e-06,
      "loss": 0.0695,
      "mae_dtheta": 0.006586496252566576,
      "mae_dx": 0.0011372924782335758,
      "mae_dy": 0.0010976362973451614,
      "pose_mae_dtheta": 0.04588157683610916,
      "pose_mae_dx": 0.011157434433698654,
      "pose_mae_dy": 0.012482837773859501,
      "pose_rmse_dtheta": 0.20324312150478363,
      "pose_rmse_dx": 0.03952481597661972,
      "pose_rmse_dy": 0.0384947694838047,
      "pose_rmse_mean": 0.09375423192977905,
      "rmse_dtheta": 0.023541804403066635,
      "rmse_dx": 0.004099587444216013,
      "rmse_dy": 0.0033936710096895695,
      "rmse_mean": 0.01034502126276493,
      "rotation_flip": 0.003197442041710019,
      "sparse_tokens": 32057.0,
      "step": 6928,
      "turn_loss": 0.04665146768093109,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.32191971752462367,
      "grad_norm": 0.4846344292163849,
      "learning_rate": 3.86236536863451e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.04250847175717354,
      "mae_dx": 0.001903891796246171,
      "mae_dy": 0.0025601156521588564,
      "pose_mae_dtheta": 0.35420894622802734,
      "pose_mae_dx": 0.016833048313856125,
      "pose_mae_dy": 0.021884959191083908,
      "pose_rmse_dtheta": 0.6949739456176758,
      "pose_rmse_dx": 0.03484264016151428,
      "pose_rmse_dy": 0.05439060553908348,
      "pose_rmse_mean": 0.2614023983478546,
      "rmse_dtheta": 0.06746982038021088,
      "rmse_dx": 0.004420955199748278,
      "rmse_dy": 0.00528537156060338,
      "rmse_mean": 0.025725385174155235,
      "rotation_flip": 0.0,
      "sparse_tokens": 2903.0,
      "step": 6929,
      "turn_loss": 0.19081392884254456,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.32196617729046645,
      "grad_norm": 0.37067458033561707,
      "learning_rate": 3.861077868738733e-06,
      "loss": 0.0921,
      "mae_dtheta": 0.007952049374580383,
      "mae_dx": 0.0015363733982667327,
      "mae_dy": 0.0016145766712725163,
      "pose_mae_dtheta": 0.05165298655629158,
      "pose_mae_dx": 0.01912938989698887,
      "pose_mae_dy": 0.01993563398718834,
      "pose_rmse_dtheta": 0.14647865295410156,
      "pose_rmse_dx": 0.05118099972605705,
      "pose_rmse_dy": 0.05669139698147774,
      "pose_rmse_mean": 0.08478368818759918,
      "rmse_dtheta": 0.02106497809290886,
      "rmse_dx": 0.004184703342616558,
      "rmse_dy": 0.003954432904720306,
      "rmse_mean": 0.009734705090522766,
      "rotation_flip": 0.0049164206720888615,
      "sparse_tokens": 32121.0,
      "step": 6930,
      "turn_loss": 0.06093129143118858,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.3220126370563092,
      "grad_norm": 0.6455036401748657,
      "learning_rate": 3.859790448488394e-06,
      "loss": 0.1603,
      "mae_dtheta": 0.03202587366104126,
      "mae_dx": 0.010692772455513477,
      "mae_dy": 0.0056201396510005,
      "pose_mae_dtheta": 0.2556198537349701,
      "pose_mae_dx": 0.07915626466274261,
      "pose_mae_dy": 0.07279662787914276,
      "pose_rmse_dtheta": 0.4822911322116852,
      "pose_rmse_dx": 0.19830140471458435,
      "pose_rmse_dy": 0.1729869395494461,
      "pose_rmse_mean": 0.2845264971256256,
      "rmse_dtheta": 0.051338810473680496,
      "rmse_dx": 0.02363872528076172,
      "rmse_dy": 0.010045690461993217,
      "rmse_mean": 0.028341075405478477,
      "rotation_flip": 0.009630818851292133,
      "sparse_tokens": 10772.0,
      "step": 6931,
      "turn_loss": 0.2749858796596527,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.322059096822152,
      "grad_norm": 0.5841270685195923,
      "learning_rate": 3.858503107973519e-06,
      "loss": 0.152,
      "mae_dtheta": 0.012639697641134262,
      "mae_dx": 0.0013099182397127151,
      "mae_dy": 0.0021342476829886436,
      "pose_mae_dtheta": 0.08409528434276581,
      "pose_mae_dx": 0.018942391499876976,
      "pose_mae_dy": 0.026366377249360085,
      "pose_rmse_dtheta": 0.2592853605747223,
      "pose_rmse_dx": 0.04882878065109253,
      "pose_rmse_dy": 0.06134064495563507,
      "pose_rmse_mean": 0.12315160036087036,
      "rmse_dtheta": 0.02974831312894821,
      "rmse_dx": 0.003356677945703268,
      "rmse_dy": 0.004535497631877661,
      "rmse_mean": 0.01254682894796133,
      "rotation_flip": 0.004927975591272116,
      "sparse_tokens": 32121.0,
      "step": 6932,
      "turn_loss": 0.07978913187980652,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.3221055565879948,
      "grad_norm": 0.4208656847476959,
      "learning_rate": 3.857215847284136e-06,
      "loss": 0.0865,
      "mae_dtheta": 0.029345298185944557,
      "mae_dx": 0.011764689348638058,
      "mae_dy": 0.005126225296407938,
      "pose_mae_dtheta": 0.22788549959659576,
      "pose_mae_dx": 0.09103429317474365,
      "pose_mae_dy": 0.06295479089021683,
      "pose_rmse_dtheta": 0.43651309609413147,
      "pose_rmse_dx": 0.1942446380853653,
      "pose_rmse_dy": 0.14717091619968414,
      "pose_rmse_mean": 0.2593095600605011,
      "rmse_dtheta": 0.047121211886405945,
      "rmse_dx": 0.02407762035727501,
      "rmse_dy": 0.00974926445633173,
      "rmse_mean": 0.02698270045220852,
      "rotation_flip": 0.007342143915593624,
      "sparse_tokens": 12316.0,
      "step": 6933,
      "turn_loss": 0.26463720202445984,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.32215201635383756,
      "grad_norm": 0.5891610980033875,
      "learning_rate": 3.8559286665102605e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.0331590436398983,
      "mae_dx": 0.013048370368778706,
      "mae_dy": 0.007304173428565264,
      "pose_mae_dtheta": 0.2573601305484772,
      "pose_mae_dx": 0.108178049325943,
      "pose_mae_dy": 0.0800810158252716,
      "pose_rmse_dtheta": 0.427640438079834,
      "pose_rmse_dx": 0.23952403664588928,
      "pose_rmse_dy": 0.16292642056941986,
      "pose_rmse_mean": 0.27669697999954224,
      "rmse_dtheta": 0.04835299402475357,
      "rmse_dx": 0.02597568742930889,
      "rmse_dy": 0.014030487276613712,
      "rmse_mean": 0.029453057795763016,
      "rotation_flip": 0.02287166379392147,
      "sparse_tokens": 13142.0,
      "step": 6934,
      "turn_loss": 0.31214120984077454,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.32219847611968033,
      "grad_norm": 0.5609745383262634,
      "learning_rate": 3.854641565741907e-06,
      "loss": 0.115,
      "mae_dtheta": 0.03493993356823921,
      "mae_dx": 0.014920002780854702,
      "mae_dy": 0.0029301373288035393,
      "pose_mae_dtheta": 0.2833925783634186,
      "pose_mae_dx": 0.1205214336514473,
      "pose_mae_dy": 0.030503569170832634,
      "pose_rmse_dtheta": 0.5286587476730347,
      "pose_rmse_dx": 0.283729612827301,
      "pose_rmse_dy": 0.06944989413022995,
      "pose_rmse_mean": 0.2939460873603821,
      "rmse_dtheta": 0.05677585303783417,
      "rmse_dx": 0.028767695650458336,
      "rmse_dy": 0.00509307999163866,
      "rmse_mean": 0.03021221235394478,
      "rotation_flip": 0.007731958758085966,
      "sparse_tokens": 6094.0,
      "step": 6935,
      "turn_loss": 0.18174105882644653,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.3222449358855231,
      "grad_norm": 0.592144787311554,
      "learning_rate": 3.853354545069086e-06,
      "loss": 0.128,
      "mae_dtheta": 0.03254285454750061,
      "mae_dx": 0.008046591654419899,
      "mae_dy": 0.0020435242913663387,
      "pose_mae_dtheta": 0.24998512864112854,
      "pose_mae_dx": 0.06087691709399223,
      "pose_mae_dy": 0.03549088537693024,
      "pose_rmse_dtheta": 0.478687584400177,
      "pose_rmse_dx": 0.15465524792671204,
      "pose_rmse_dy": 0.07494708150625229,
      "pose_rmse_mean": 0.23609665036201477,
      "rmse_dtheta": 0.05240938812494278,
      "rmse_dx": 0.017821360379457474,
      "rmse_dy": 0.004654087126255035,
      "rmse_mean": 0.02496161311864853,
      "rotation_flip": 0.03333333507180214,
      "sparse_tokens": 2948.0,
      "step": 6936,
      "turn_loss": 0.14259906113147736,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.32229139565136594,
      "grad_norm": 1.0522513389587402,
      "learning_rate": 3.8520676045817945e-06,
      "loss": 0.2516,
      "mae_dtheta": 0.03802856057882309,
      "mae_dx": 0.009666512720286846,
      "mae_dy": 0.004818913992494345,
      "pose_mae_dtheta": 0.30411040782928467,
      "pose_mae_dx": 0.08097737282514572,
      "pose_mae_dy": 0.054458413273096085,
      "pose_rmse_dtheta": 0.5393306016921997,
      "pose_rmse_dx": 0.18778739869594574,
      "pose_rmse_dy": 0.11731313914060593,
      "pose_rmse_mean": 0.28147706389427185,
      "rmse_dtheta": 0.05714748427271843,
      "rmse_dx": 0.02095697447657585,
      "rmse_dy": 0.009380419738590717,
      "rmse_mean": 0.02916162833571434,
      "rotation_flip": 0.009267060086131096,
      "sparse_tokens": 18742.0,
      "step": 6937,
      "turn_loss": 0.25808843970298767,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 15269.0,
      "epoch": 0.3223378554172087,
      "grad_norm": 0.5596095323562622,
      "learning_rate": 3.850780744370034e-06,
      "loss": 0.128,
      "mae_dtheta": 0.028814012184739113,
      "mae_dx": 0.009766008704900742,
      "mae_dy": 0.004914747551083565,
      "pose_mae_dtheta": 0.2266571819782257,
      "pose_mae_dx": 0.07678521424531937,
      "pose_mae_dy": 0.05137127265334129,
      "pose_rmse_dtheta": 0.44051510095596313,
      "pose_rmse_dx": 0.18862877786159515,
      "pose_rmse_dy": 0.11062611639499664,
      "pose_rmse_mean": 0.2465900033712387,
      "rmse_dtheta": 0.04849834740161896,
      "rmse_dx": 0.020962856709957123,
      "rmse_dy": 0.009455215185880661,
      "rmse_mean": 0.02630547247827053,
      "rotation_flip": 0.012642225250601768,
      "sparse_tokens": 11582.0,
      "step": 6938,
      "turn_loss": 0.24581286311149597,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3223843151830515,
      "grad_norm": 0.5852769017219543,
      "learning_rate": 3.849493964523791e-06,
      "loss": 0.1592,
      "mae_dtheta": 0.012054922990500927,
      "mae_dx": 0.0013442292110994458,
      "mae_dy": 0.0019322832813486457,
      "pose_mae_dtheta": 0.08401696383953094,
      "pose_mae_dx": 0.020364632830023766,
      "pose_mae_dy": 0.02661905251443386,
      "pose_rmse_dtheta": 0.2427244931459427,
      "pose_rmse_dx": 0.05050266534090042,
      "pose_rmse_dy": 0.06255428493022919,
      "pose_rmse_mean": 0.11859381198883057,
      "rmse_dtheta": 0.027748310938477516,
      "rmse_dx": 0.003881927812471986,
      "rmse_dy": 0.003962851595133543,
      "rmse_mean": 0.01186436414718628,
      "rotation_flip": 0.00503144646063447,
      "sparse_tokens": 32105.0,
      "step": 6939,
      "turn_loss": 0.08416596055030823,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.32243077494889427,
      "grad_norm": 0.6742404699325562,
      "learning_rate": 3.848207265133054e-06,
      "loss": 0.1704,
      "mae_dtheta": 0.035898059606552124,
      "mae_dx": 0.012547984719276428,
      "mae_dy": 0.004747568164020777,
      "pose_mae_dtheta": 0.31245681643486023,
      "pose_mae_dx": 0.09984556585550308,
      "pose_mae_dy": 0.07189764082431793,
      "pose_rmse_dtheta": 0.5310364961624146,
      "pose_rmse_dx": 0.22548775374889374,
      "pose_rmse_dy": 0.18934805691242218,
      "pose_rmse_mean": 0.31529077887535095,
      "rmse_dtheta": 0.05457635596394539,
      "rmse_dx": 0.02530922181904316,
      "rmse_dy": 0.009038329124450684,
      "rmse_mean": 0.029641304165124893,
      "rotation_flip": 0.017191976308822632,
      "sparse_tokens": 12213.0,
      "step": 6940,
      "turn_loss": 0.21267548203468323,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.32247723471473705,
      "grad_norm": 0.5305512547492981,
      "learning_rate": 3.8469206462878e-06,
      "loss": 0.0753,
      "mae_dtheta": 0.0077868858352303505,
      "mae_dx": 0.0015535339480265975,
      "mae_dy": 0.0016279915580525994,
      "pose_mae_dtheta": 0.05374354124069214,
      "pose_mae_dx": 0.018397696316242218,
      "pose_mae_dy": 0.021725976839661598,
      "pose_rmse_dtheta": 0.11886419355869293,
      "pose_rmse_dx": 0.051672741770744324,
      "pose_rmse_dy": 0.055712755769491196,
      "pose_rmse_mean": 0.07541656494140625,
      "rmse_dtheta": 0.016829118132591248,
      "rmse_dx": 0.00553848734125495,
      "rmse_dy": 0.003679828019812703,
      "rmse_mean": 0.008682478219270706,
      "rotation_flip": 0.0032284099142998457,
      "sparse_tokens": 32121.0,
      "step": 6941,
      "turn_loss": 0.05732711777091026,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3225236944805798,
      "grad_norm": 0.5400125980377197,
      "learning_rate": 3.845634108078003e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.012760382145643234,
      "mae_dx": 0.0013854014687240124,
      "mae_dy": 0.0026230737566947937,
      "pose_mae_dtheta": 0.08031291514635086,
      "pose_mae_dx": 0.024925783276557922,
      "pose_mae_dy": 0.032465916126966476,
      "pose_rmse_dtheta": 0.2150481641292572,
      "pose_rmse_dx": 0.06302335858345032,
      "pose_rmse_dy": 0.06977624446153641,
      "pose_rmse_mean": 0.11594925820827484,
      "rmse_dtheta": 0.0272583719342947,
      "rmse_dx": 0.003615043591707945,
      "rmse_dy": 0.0052862889133393764,
      "rmse_mean": 0.012053235433995724,
      "rotation_flip": 0.0044247787445783615,
      "sparse_tokens": 32089.0,
      "step": 6942,
      "turn_loss": 0.08906644582748413,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3225701542464226,
      "grad_norm": 0.38431569933891296,
      "learning_rate": 3.844347650593635e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.010618269443511963,
      "mae_dx": 0.0012329728342592716,
      "mae_dy": 0.0024420241825282574,
      "pose_mae_dtheta": 0.0661228597164154,
      "pose_mae_dx": 0.0177040696144104,
      "pose_mae_dy": 0.027007345110177994,
      "pose_rmse_dtheta": 0.1722986400127411,
      "pose_rmse_dx": 0.05634302273392677,
      "pose_rmse_dy": 0.06238742917776108,
      "pose_rmse_mean": 0.09700970351696014,
      "rmse_dtheta": 0.024549998342990875,
      "rmse_dx": 0.0038502109237015247,
      "rmse_dy": 0.006033346056938171,
      "rmse_mean": 0.011477852240204811,
      "rotation_flip": 0.004911220166832209,
      "sparse_tokens": 32105.0,
      "step": 6943,
      "turn_loss": 0.08735840767621994,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.3226166140122654,
      "grad_norm": 0.7216649651527405,
      "learning_rate": 3.843061273924654e-06,
      "loss": 0.1932,
      "mae_dtheta": 0.04660312086343765,
      "mae_dx": 0.014898102730512619,
      "mae_dy": 0.0069008455611765385,
      "pose_mae_dtheta": 0.3781384825706482,
      "pose_mae_dx": 0.11590884625911713,
      "pose_mae_dy": 0.07569845765829086,
      "pose_rmse_dtheta": 0.6292219161987305,
      "pose_rmse_dx": 0.22509849071502686,
      "pose_rmse_dy": 0.19304633140563965,
      "pose_rmse_mean": 0.3491222560405731,
      "rmse_dtheta": 0.06447090953588486,
      "rmse_dx": 0.02632085047662258,
      "rmse_dy": 0.014304285869002342,
      "rmse_mean": 0.03503201901912689,
      "rotation_flip": 0.008968610316514969,
      "sparse_tokens": 17550.0,
      "step": 6944,
      "turn_loss": 0.38946327567100525,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.32266307377810816,
      "grad_norm": 0.41119831800460815,
      "learning_rate": 3.841774978161022e-06,
      "loss": 0.0817,
      "mae_dtheta": 0.006565794814378023,
      "mae_dx": 0.0009375348454341292,
      "mae_dy": 0.001277993549592793,
      "pose_mae_dtheta": 0.04198640212416649,
      "pose_mae_dx": 0.011946418322622776,
      "pose_mae_dy": 0.018590735271573067,
      "pose_rmse_dtheta": 0.09387382119894028,
      "pose_rmse_dx": 0.03457208350300789,
      "pose_rmse_dy": 0.046406377106904984,
      "pose_rmse_mean": 0.05828409641981125,
      "rmse_dtheta": 0.01473510917276144,
      "rmse_dx": 0.0031317626126110554,
      "rmse_dy": 0.002898534992709756,
      "rmse_mean": 0.006921802647411823,
      "rotation_flip": 0.00048053820501081645,
      "sparse_tokens": 32073.0,
      "step": 6945,
      "turn_loss": 0.05167168378829956,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.32270953354395093,
      "grad_norm": 0.7875869870185852,
      "learning_rate": 3.840488763392685e-06,
      "loss": 0.1414,
      "mae_dtheta": 0.008063866756856441,
      "mae_dx": 0.0012604182120412588,
      "mae_dy": 0.0015580327017232776,
      "pose_mae_dtheta": 0.0511401891708374,
      "pose_mae_dx": 0.01794605888426304,
      "pose_mae_dy": 0.02183344028890133,
      "pose_rmse_dtheta": 0.11163513362407684,
      "pose_rmse_dx": 0.04531043767929077,
      "pose_rmse_dy": 0.049646053463220596,
      "pose_rmse_mean": 0.0688638761639595,
      "rmse_dtheta": 0.018111402168869972,
      "rmse_dx": 0.00379869039170444,
      "rmse_dy": 0.0035095028579235077,
      "rmse_mean": 0.008473198860883713,
      "rotation_flip": 0.0,
      "sparse_tokens": 32137.0,
      "step": 6946,
      "turn_loss": 0.06161653995513916,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32986.0,
      "epoch": 0.3227559933097937,
      "grad_norm": 0.5799911618232727,
      "learning_rate": 3.8392026297095906e-06,
      "loss": 0.2008,
      "mae_dtheta": 0.04493425786495209,
      "mae_dx": 0.013022960163652897,
      "mae_dy": 0.004129317589104176,
      "pose_mae_dtheta": 0.3925083875656128,
      "pose_mae_dx": 0.11111405491828918,
      "pose_mae_dy": 0.05723629146814346,
      "pose_rmse_dtheta": 0.615392804145813,
      "pose_rmse_dx": 0.23569434881210327,
      "pose_rmse_dy": 0.1657165139913559,
      "pose_rmse_mean": 0.3389345407485962,
      "rmse_dtheta": 0.061574358493089676,
      "rmse_dx": 0.02492104284465313,
      "rmse_dy": 0.009127426892518997,
      "rmse_mean": 0.03187427669763565,
      "rotation_flip": 0.017307693138718605,
      "sparse_tokens": 27308.0,
      "step": 6947,
      "turn_loss": 0.2769354581832886,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 2302.0,
      "epoch": 0.3228024530756365,
      "grad_norm": 1.1423900127410889,
      "learning_rate": 3.8379165772016815e-06,
      "loss": 0.2655,
      "mae_dtheta": 0.030252188444137573,
      "mae_dx": 0.016686169430613518,
      "mae_dy": 0.005781315267086029,
      "pose_mae_dtheta": 0.24571841955184937,
      "pose_mae_dx": 0.12425743043422699,
      "pose_mae_dy": 0.06768356263637543,
      "pose_rmse_dtheta": 0.32842060923576355,
      "pose_rmse_dx": 0.20876270532608032,
      "pose_rmse_dy": 0.11631730943918228,
      "pose_rmse_mean": 0.21783354878425598,
      "rmse_dtheta": 0.03849250078201294,
      "rmse_dx": 0.028625259175896645,
      "rmse_dy": 0.008966934867203236,
      "rmse_mean": 0.025361565873026848,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 1768.0,
      "step": 6948,
      "turn_loss": 0.2842123210430145,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.32284891284147926,
      "grad_norm": 0.43356069922447205,
      "learning_rate": 3.8366306059588885e-06,
      "loss": 0.1262,
      "mae_dtheta": 0.011260136030614376,
      "mae_dx": 0.001823056605644524,
      "mae_dy": 0.0024871905334293842,
      "pose_mae_dtheta": 0.07032820582389832,
      "pose_mae_dx": 0.02346367947757244,
      "pose_mae_dy": 0.027556737884879112,
      "pose_rmse_dtheta": 0.17839547991752625,
      "pose_rmse_dx": 0.06156184896826744,
      "pose_rmse_dy": 0.06562601774930954,
      "pose_rmse_mean": 0.10186111927032471,
      "rmse_dtheta": 0.024909814819693565,
      "rmse_dx": 0.0058552855625748634,
      "rmse_dy": 0.005455471575260162,
      "rmse_mean": 0.012073524296283722,
      "rotation_flip": 0.00327332247979939,
      "sparse_tokens": 32041.0,
      "step": 6949,
      "turn_loss": 0.121499203145504,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.32289537260732204,
      "grad_norm": 0.45505326986312866,
      "learning_rate": 3.8353447160711435e-06,
      "loss": 0.1154,
      "mae_dtheta": 0.010649682953953743,
      "mae_dx": 0.0025237901136279106,
      "mae_dy": 0.0026699556037783623,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4550531804561615,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 163.33616638183594,
      "model/head/act_norm_mean": 113.55444089330808,
      "model/head/act_norm_min": 51.632965087890625,
      "model/head/act_over_embed": 78.03567489530658,
      "model/head/grad_frac": 0.10685467720031738,
      "model/head/grad_norm": 0.04862456023693085,
      "model/head/grad_zero_frac": 0.00019512213475536555,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7103900331439394,
      "model/head/update_ratio": 0.0008294043364003301,
      "model/head/weight_delta": 9.367860794067383,
      "model/head/weight_delta_rel": 0.16434001922607422,
      "model/head/weight_norm": 58.62588119506836,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4217360317707062,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4216658836187318,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42160260677337646,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2897727429209919,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09748495370149612,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04436083883047104,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.49997274709302325,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001433015102520585,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0173261165618896,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09858544915914536,
      "model/modality_embedder.encoders.pose/weight_norm": 30.956295013427734,
      "model/modality_embedder/grad_frac": 0.09748495370149612,
      "model/modality_embedder/grad_norm": 0.04436083883047104,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.49997274709302325,
      "model/modality_embedder/update_ratio": 0.001433015102520585,
      "model/modality_embedder/weight_delta": 3.0173261165618896,
      "model/modality_embedder/weight_delta_rel": 0.09858544915914536,
      "model/modality_embedder/weight_norm": 30.956295013427734,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.1468734741211,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.93137225428892,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.08531379699707,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.44586306218434,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07457125186920166,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.033933885395526886,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012163531500846148,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4518089294433594,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08934539556503296,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.898054122924805,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.65215301513672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.885323973865642,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.334517478942871,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.101427614914172,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07480721920728683,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03404126316308975,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011474968632683158,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1089460849761963,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10769632458686829,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.665668487548828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.79039001464844,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.705251924001924,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.108278274536133,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.35209914068174,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08355207741260529,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03802063688635826,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001241251127794385,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.355473518371582,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11267051845788956,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.63089942932129,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.60796356201172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.46123186227353,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.320608139038086,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.55882499400518,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09392592310905457,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04274129122495651,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014308870304375887,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.870809316635132,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0981106385588646,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.870487213134766,
      "model/normalizer/grad_frac": 0.3557196259498596,
      "model/normalizer/grad_norm": 0.16187134385108948,
      "model/normalizer/grad_zero_frac": 0.0002079859550576657,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020609796047210693,
      "model/normalizer/weight_delta": 6.069178104400635,
      "model/normalizer/weight_delta_rel": 0.07816749811172485,
      "model/normalizer/weight_norm": 78.54096984863281,
      "pose_mae_dtheta": 0.07305742055177689,
      "pose_mae_dx": 0.027503198012709618,
      "pose_mae_dy": 0.02780156023800373,
      "pose_rmse_dtheta": 0.1749594658613205,
      "pose_rmse_dx": 0.07453024387359619,
      "pose_rmse_dy": 0.06868074834346771,
      "pose_rmse_mean": 0.1060568243265152,
      "rmse_dtheta": 0.02392030693590641,
      "rmse_dx": 0.00851159356534481,
      "rmse_dy": 0.0071937283501029015,
      "rmse_mean": 0.013208543881773949,
      "rotation_flip": 0.002772643230855465,
      "sparse_tokens": 32041.0,
      "step": 6950,
      "turn_loss": 0.10127662867307663,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3229418323731648,
      "grad_norm": 0.38328173756599426,
      "learning_rate": 3.834058907628365e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.005236735101789236,
      "mae_dx": 0.0012610414996743202,
      "mae_dy": 0.0012422604486346245,
      "pose_mae_dtheta": 0.03674142435193062,
      "pose_mae_dx": 0.01237044669687748,
      "pose_mae_dy": 0.014267656952142715,
      "pose_rmse_dtheta": 0.10285497456789017,
      "pose_rmse_dx": 0.035490572452545166,
      "pose_rmse_dy": 0.035827863961458206,
      "pose_rmse_mean": 0.05805779993534088,
      "rmse_dtheta": 0.015045145526528358,
      "rmse_dx": 0.004276033956557512,
      "rmse_dy": 0.0042362092062830925,
      "rmse_mean": 0.00785246305167675,
      "rotation_flip": 0.0071428571827709675,
      "sparse_tokens": 32089.0,
      "step": 6951,
      "turn_loss": 0.05059385672211647,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.3229882921390076,
      "grad_norm": 0.7423182725906372,
      "learning_rate": 3.832773180720475e-06,
      "loss": 0.1867,
      "mae_dtheta": 0.04361916333436966,
      "mae_dx": 0.00677903089672327,
      "mae_dy": 0.005721678026020527,
      "pose_mae_dtheta": 0.37679314613342285,
      "pose_mae_dx": 0.030276373028755188,
      "pose_mae_dy": 0.06841403990983963,
      "pose_rmse_dtheta": 0.68807452917099,
      "pose_rmse_dx": 0.08438631892204285,
      "pose_rmse_dy": 0.1886736899614334,
      "pose_rmse_mean": 0.3203781843185425,
      "rmse_dtheta": 0.06689035892486572,
      "rmse_dx": 0.01722908392548561,
      "rmse_dy": 0.01358829252421856,
      "rmse_mean": 0.032569244503974915,
      "rotation_flip": 0.013636363670229912,
      "sparse_tokens": 3254.0,
      "step": 6952,
      "turn_loss": 0.2585805654525757,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 26607.0,
      "epoch": 0.3230347519048504,
      "grad_norm": 0.49546414613723755,
      "learning_rate": 3.8314875354373806e-06,
      "loss": 0.115,
      "mae_dtheta": 0.032555561512708664,
      "mae_dx": 0.011020591482520103,
      "mae_dy": 0.0031145464163273573,
      "pose_mae_dtheta": 0.2545839250087738,
      "pose_mae_dx": 0.08726610243320465,
      "pose_mae_dy": 0.03241870552301407,
      "pose_rmse_dtheta": 0.47018489241600037,
      "pose_rmse_dx": 0.22791688144207,
      "pose_rmse_dy": 0.08184545487165451,
      "pose_rmse_mean": 0.2599824070930481,
      "rmse_dtheta": 0.051989197731018066,
      "rmse_dx": 0.02422795444726944,
      "rmse_dy": 0.006302656605839729,
      "rmse_mean": 0.027506602928042412,
      "rotation_flip": 0.011252813041210175,
      "sparse_tokens": 19101.0,
      "step": 6953,
      "turn_loss": 0.23781953752040863,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3230812116706932,
      "grad_norm": 0.40992069244384766,
      "learning_rate": 3.83020197186899e-06,
      "loss": 0.103,
      "mae_dtheta": 0.009745068848133087,
      "mae_dx": 0.002160829957574606,
      "mae_dy": 0.002887905575335026,
      "pose_mae_dtheta": 0.06839275360107422,
      "pose_mae_dx": 0.02787717804312706,
      "pose_mae_dy": 0.030585259199142456,
      "pose_rmse_dtheta": 0.1664774864912033,
      "pose_rmse_dx": 0.09095532447099686,
      "pose_rmse_dy": 0.08191382884979248,
      "pose_rmse_mean": 0.11311554908752441,
      "rmse_dtheta": 0.02251276932656765,
      "rmse_dx": 0.007410227786749601,
      "rmse_dy": 0.007991823367774487,
      "rmse_mean": 0.012638273648917675,
      "rotation_flip": 0.006906077265739441,
      "sparse_tokens": 32073.0,
      "step": 6954,
      "turn_loss": 0.09020065516233444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.323127671436536,
      "grad_norm": 0.6099579334259033,
      "learning_rate": 3.828916490105206e-06,
      "loss": 0.0881,
      "mae_dtheta": 0.009981133043766022,
      "mae_dx": 0.001851139822974801,
      "mae_dy": 0.001637419918552041,
      "pose_mae_dtheta": 0.07271641492843628,
      "pose_mae_dx": 0.019886882975697517,
      "pose_mae_dy": 0.019067835062742233,
      "pose_rmse_dtheta": 0.22696763277053833,
      "pose_rmse_dx": 0.05560983717441559,
      "pose_rmse_dy": 0.047184836119413376,
      "pose_rmse_mean": 0.10992076247930527,
      "rmse_dtheta": 0.026697229593992233,
      "rmse_dx": 0.005560511257499456,
      "rmse_dy": 0.004503071308135986,
      "rmse_mean": 0.012253603897988796,
      "rotation_flip": 0.0022865852806717157,
      "sparse_tokens": 32185.0,
      "step": 6955,
      "turn_loss": 0.08667714893817902,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.32317413120237876,
      "grad_norm": 0.3824688196182251,
      "learning_rate": 3.8276310902359185e-06,
      "loss": 0.1001,
      "mae_dtheta": 0.041595425456762314,
      "mae_dx": 0.012102339416742325,
      "mae_dy": 0.00867397803813219,
      "pose_mae_dtheta": 0.3300309181213379,
      "pose_mae_dx": 0.11230970174074173,
      "pose_mae_dy": 0.0952107161283493,
      "pose_rmse_dtheta": 0.5786809921264648,
      "pose_rmse_dx": 0.22812850773334503,
      "pose_rmse_dy": 0.20819638669490814,
      "pose_rmse_mean": 0.3383352756500244,
      "rmse_dtheta": 0.06055184081196785,
      "rmse_dx": 0.02358172833919525,
      "rmse_dy": 0.01711016520857811,
      "rmse_mean": 0.03374791145324707,
      "rotation_flip": 0.017709562554955482,
      "sparse_tokens": 14174.0,
      "step": 6956,
      "turn_loss": 0.3898085057735443,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.32322059096822153,
      "grad_norm": 0.45797595381736755,
      "learning_rate": 3.82634577235102e-06,
      "loss": 0.0976,
      "mae_dtheta": 0.012930949218571186,
      "mae_dx": 0.0025425846688449383,
      "mae_dy": 0.0037414238322526217,
      "pose_mae_dtheta": 0.09324200451374054,
      "pose_mae_dx": 0.031300317496061325,
      "pose_mae_dy": 0.034752290695905685,
      "pose_rmse_dtheta": 0.2352006584405899,
      "pose_rmse_dx": 0.10021869838237762,
      "pose_rmse_dy": 0.08070659637451172,
      "pose_rmse_mean": 0.13870865106582642,
      "rmse_dtheta": 0.02858145534992218,
      "rmse_dx": 0.00787569023668766,
      "rmse_dy": 0.009276358410716057,
      "rmse_mean": 0.015244501642882824,
      "rotation_flip": 0.007561436854302883,
      "sparse_tokens": 32057.0,
      "step": 6957,
      "turn_loss": 0.12146659940481186,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3232670507340643,
      "grad_norm": 0.4560798108577728,
      "learning_rate": 3.825060536540389e-06,
      "loss": 0.0759,
      "mae_dtheta": 0.007379166316241026,
      "mae_dx": 0.001734391087666154,
      "mae_dy": 0.0025502583011984825,
      "pose_mae_dtheta": 0.04711629077792168,
      "pose_mae_dx": 0.022053517401218414,
      "pose_mae_dy": 0.02280171401798725,
      "pose_rmse_dtheta": 0.14499256014823914,
      "pose_rmse_dx": 0.06329046934843063,
      "pose_rmse_dy": 0.0531051829457283,
      "pose_rmse_mean": 0.08712940663099289,
      "rmse_dtheta": 0.018500646576285362,
      "rmse_dx": 0.005913618486374617,
      "rmse_dy": 0.005933090578764677,
      "rmse_mean": 0.010115785524249077,
      "rotation_flip": 0.003026372753083706,
      "sparse_tokens": 32073.0,
      "step": 6958,
      "turn_loss": 0.05755952000617981,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.3233135104999071,
      "grad_norm": 0.335896760225296,
      "learning_rate": 3.823775382893908e-06,
      "loss": 0.0829,
      "mae_dtheta": 0.008526287041604519,
      "mae_dx": 0.001713574631139636,
      "mae_dy": 0.001303748576901853,
      "pose_mae_dtheta": 0.06428197026252747,
      "pose_mae_dx": 0.01893792487680912,
      "pose_mae_dy": 0.01709907501935959,
      "pose_rmse_dtheta": 0.19030721485614777,
      "pose_rmse_dx": 0.052585892379283905,
      "pose_rmse_dy": 0.05745914205908775,
      "pose_rmse_mean": 0.10011741518974304,
      "rmse_dtheta": 0.023087479174137115,
      "rmse_dx": 0.004692330025136471,
      "rmse_dy": 0.0037710661999881268,
      "rmse_mean": 0.010516959242522717,
      "rotation_flip": 0.0027149321977049112,
      "sparse_tokens": 32217.0,
      "step": 6959,
      "turn_loss": 0.06226947903633118,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.32335997026574986,
      "grad_norm": 0.334739089012146,
      "learning_rate": 3.822490311501443e-06,
      "loss": 0.0708,
      "mae_dtheta": 0.013259369879961014,
      "mae_dx": 0.003671316197142005,
      "mae_dy": 0.003818968776613474,
      "pose_mae_dtheta": 0.0839919000864029,
      "pose_mae_dx": 0.020255181938409805,
      "pose_mae_dy": 0.03412000462412834,
      "pose_rmse_dtheta": 0.155999094247818,
      "pose_rmse_dx": 0.04201802611351013,
      "pose_rmse_dy": 0.0732448399066925,
      "pose_rmse_mean": 0.09042065590620041,
      "rmse_dtheta": 0.025028008967638016,
      "rmse_dx": 0.008620440028607845,
      "rmse_dy": 0.009704905562102795,
      "rmse_mean": 0.014451119117438793,
      "rotation_flip": 0.0181818176060915,
      "sparse_tokens": 3595.0,
      "step": 6960,
      "turn_loss": 0.1296870857477188,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.32340643003159264,
      "grad_norm": 0.3438047468662262,
      "learning_rate": 3.821205322452863e-06,
      "loss": 0.0857,
      "mae_dtheta": 0.009168263524770737,
      "mae_dx": 0.0019443726632744074,
      "mae_dy": 0.002423727186396718,
      "pose_mae_dtheta": 0.06498191505670547,
      "pose_mae_dx": 0.025470325723290443,
      "pose_mae_dy": 0.027568869292736053,
      "pose_rmse_dtheta": 0.14658598601818085,
      "pose_rmse_dx": 0.06958021968603134,
      "pose_rmse_dy": 0.06540577113628387,
      "pose_rmse_mean": 0.09385733306407928,
      "rmse_dtheta": 0.020037110894918442,
      "rmse_dx": 0.005529726389795542,
      "rmse_dy": 0.005753453355282545,
      "rmse_mean": 0.010440096259117126,
      "rotation_flip": 0.0037267080042511225,
      "sparse_tokens": 32089.0,
      "step": 6961,
      "turn_loss": 0.07581359148025513,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3234528897974354,
      "grad_norm": 1.2355694770812988,
      "learning_rate": 3.8199204158380295e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.008542455732822418,
      "mae_dx": 0.0012432349612936378,
      "mae_dy": 0.0006807252648286521,
      "pose_mae_dtheta": 0.064864881336689,
      "pose_mae_dx": 0.010810600593686104,
      "pose_mae_dy": 0.011139060370624065,
      "pose_rmse_dtheta": 0.25246623158454895,
      "pose_rmse_dx": 0.02671581692993641,
      "pose_rmse_dy": 0.02784242294728756,
      "pose_rmse_mean": 0.10234149545431137,
      "rmse_dtheta": 0.027177833020687103,
      "rmse_dx": 0.003987906966358423,
      "rmse_dy": 0.0013611343456432223,
      "rmse_mean": 0.01084229163825512,
      "rotation_flip": 0.00046511628897860646,
      "sparse_tokens": 32169.0,
      "step": 6962,
      "turn_loss": 0.051800910383462906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.3234993495632782,
      "grad_norm": 0.6712316274642944,
      "learning_rate": 3.818635591746794e-06,
      "loss": 0.161,
      "mae_dtheta": 0.03577763959765434,
      "mae_dx": 0.012908723205327988,
      "mae_dy": 0.005765492562204599,
      "pose_mae_dtheta": 0.25819090008735657,
      "pose_mae_dx": 0.10113733261823654,
      "pose_mae_dy": 0.06624970585107803,
      "pose_rmse_dtheta": 0.4557291567325592,
      "pose_rmse_dx": 0.22369599342346191,
      "pose_rmse_dy": 0.161762073636055,
      "pose_rmse_mean": 0.2803957462310791,
      "rmse_dtheta": 0.053494978696107864,
      "rmse_dx": 0.02555365487933159,
      "rmse_dy": 0.012018639594316483,
      "rmse_mean": 0.030355757102370262,
      "rotation_flip": 0.018384767696261406,
      "sparse_tokens": 25074.0,
      "step": 6963,
      "turn_loss": 0.29805395007133484,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.32354580932912097,
      "grad_norm": 0.39973193407058716,
      "learning_rate": 3.817350850269006e-06,
      "loss": 0.0963,
      "mae_dtheta": 0.005766792688518763,
      "mae_dx": 0.0014028085861355066,
      "mae_dy": 0.0008951266063377261,
      "pose_mae_dtheta": 0.040471628308296204,
      "pose_mae_dx": 0.012582686729729176,
      "pose_mae_dy": 0.011410280130803585,
      "pose_rmse_dtheta": 0.1552382856607437,
      "pose_rmse_dx": 0.0349639467895031,
      "pose_rmse_dy": 0.035108745098114014,
      "pose_rmse_mean": 0.07510366290807724,
      "rmse_dtheta": 0.020364534109830856,
      "rmse_dx": 0.004690623842179775,
      "rmse_dy": 0.0026411013677716255,
      "rmse_mean": 0.009232087060809135,
      "rotation_flip": 0.0006261740927584469,
      "sparse_tokens": 32105.0,
      "step": 6964,
      "turn_loss": 0.049595851451158524,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.32359226909496375,
      "grad_norm": 0.5495979189872742,
      "learning_rate": 3.816066191494507e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.037316806614398956,
      "mae_dx": 0.005478518549352884,
      "mae_dy": 0.0060225967317819595,
      "pose_mae_dtheta": 0.28856661915779114,
      "pose_mae_dx": 0.06398069858551025,
      "pose_mae_dy": 0.060902077704668045,
      "pose_rmse_dtheta": 0.5587046146392822,
      "pose_rmse_dx": 0.13425256311893463,
      "pose_rmse_dy": 0.12234608083963394,
      "pose_rmse_mean": 0.2717677652835846,
      "rmse_dtheta": 0.05808113142848015,
      "rmse_dx": 0.01193116046488285,
      "rmse_dy": 0.011112025007605553,
      "rmse_mean": 0.027041440829634666,
      "rotation_flip": 0.021739130839705467,
      "sparse_tokens": 3830.0,
      "step": 6965,
      "turn_loss": 0.17831628024578094,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 37198.0,
      "epoch": 0.3236387288608065,
      "grad_norm": 0.5920276641845703,
      "learning_rate": 3.8147816155131345e-06,
      "loss": 0.1919,
      "mae_dtheta": 0.04253711551427841,
      "mae_dx": 0.012850658968091011,
      "mae_dy": 0.0059091500006616116,
      "pose_mae_dtheta": 0.35658255219459534,
      "pose_mae_dx": 0.0973372608423233,
      "pose_mae_dy": 0.07936521619558334,
      "pose_rmse_dtheta": 0.6022937893867493,
      "pose_rmse_dx": 0.2019689828157425,
      "pose_rmse_dy": 0.19973663985729218,
      "pose_rmse_mean": 0.3346664607524872,
      "rmse_dtheta": 0.06153969466686249,
      "rmse_dx": 0.02483920194208622,
      "rmse_dy": 0.013540881685912609,
      "rmse_mean": 0.03330659121274948,
      "rotation_flip": 0.007403188850730658,
      "sparse_tokens": 27961.0,
      "step": 6966,
      "turn_loss": 0.30729490518569946,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.3236851886266493,
      "grad_norm": 0.6733565926551819,
      "learning_rate": 3.8134971224147204e-06,
      "loss": 0.1381,
      "mae_dtheta": 0.029917262494564056,
      "mae_dx": 0.009079028852283955,
      "mae_dy": 0.0035310841631144285,
      "pose_mae_dtheta": 0.22234711050987244,
      "pose_mae_dx": 0.05902133509516716,
      "pose_mae_dy": 0.05424879491329193,
      "pose_rmse_dtheta": 0.42002424597740173,
      "pose_rmse_dx": 0.152141273021698,
      "pose_rmse_dy": 0.12409460544586182,
      "pose_rmse_mean": 0.23208670318126678,
      "rmse_dtheta": 0.04781489446759224,
      "rmse_dx": 0.021178198978304863,
      "rmse_dy": 0.007031985558569431,
      "rmse_mean": 0.025341693311929703,
      "rotation_flip": 0.002710027154535055,
      "sparse_tokens": 7596.0,
      "step": 6967,
      "turn_loss": 0.18828308582305908,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3237316483924921,
      "grad_norm": 0.5119773149490356,
      "learning_rate": 3.8122127122890886e-06,
      "loss": 0.145,
      "mae_dtheta": 0.013358901254832745,
      "mae_dx": 0.002246132120490074,
      "mae_dy": 0.00438001099973917,
      "pose_mae_dtheta": 0.08733862638473511,
      "pose_mae_dx": 0.033064644783735275,
      "pose_mae_dy": 0.03928979113698006,
      "pose_rmse_dtheta": 0.22852778434753418,
      "pose_rmse_dx": 0.07574678957462311,
      "pose_rmse_dy": 0.08737552165985107,
      "pose_rmse_mean": 0.13055002689361572,
      "rmse_dtheta": 0.026421478018164635,
      "rmse_dx": 0.005702512804418802,
      "rmse_dy": 0.00890951044857502,
      "rmse_mean": 0.01367783360183239,
      "rotation_flip": 0.010030395351350307,
      "sparse_tokens": 32105.0,
      "step": 6968,
      "turn_loss": 0.1140345111489296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.3237781081583349,
      "grad_norm": 0.6086348295211792,
      "learning_rate": 3.81092838522606e-06,
      "loss": 0.1544,
      "mae_dtheta": 0.030557934194803238,
      "mae_dx": 0.007535595912486315,
      "mae_dy": 0.006326144561171532,
      "pose_mae_dtheta": 0.23796755075454712,
      "pose_mae_dx": 0.06968934834003448,
      "pose_mae_dy": 0.07485450804233551,
      "pose_rmse_dtheta": 0.42056554555892944,
      "pose_rmse_dx": 0.16794386506080627,
      "pose_rmse_dy": 0.13937592506408691,
      "pose_rmse_mean": 0.24262845516204834,
      "rmse_dtheta": 0.04589679092168808,
      "rmse_dx": 0.017575407400727272,
      "rmse_dy": 0.012497209943830967,
      "rmse_mean": 0.025323135778307915,
      "rotation_flip": 0.014412417076528072,
      "sparse_tokens": 17329.0,
      "step": 6969,
      "turn_loss": 0.27964338660240173,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3238245679241777,
      "grad_norm": 0.4777926802635193,
      "learning_rate": 3.8096441413154468e-06,
      "loss": 0.1014,
      "mae_dtheta": 0.011486741714179516,
      "mae_dx": 0.0020148935727775097,
      "mae_dy": 0.002836919855326414,
      "pose_mae_dtheta": 0.07482385635375977,
      "pose_mae_dx": 0.023580538108944893,
      "pose_mae_dy": 0.03514636680483818,
      "pose_rmse_dtheta": 0.1447039097547531,
      "pose_rmse_dx": 0.0696713775396347,
      "pose_rmse_dy": 0.08913712948560715,
      "pose_rmse_mean": 0.10117080807685852,
      "rmse_dtheta": 0.02104073204100132,
      "rmse_dx": 0.00670176837593317,
      "rmse_dy": 0.006799125578254461,
      "rmse_mean": 0.011513875797390938,
      "rotation_flip": 0.006936838384717703,
      "sparse_tokens": 32105.0,
      "step": 6970,
      "turn_loss": 0.11415570974349976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.32387102769002046,
      "grad_norm": 0.4057386815547943,
      "learning_rate": 3.8083599806470594e-06,
      "loss": 0.0733,
      "mae_dtheta": 0.006421221420168877,
      "mae_dx": 0.0010875790612772107,
      "mae_dy": 0.0010455992305651307,
      "pose_mae_dtheta": 0.042107488960027695,
      "pose_mae_dx": 0.011182752437889576,
      "pose_mae_dy": 0.011856252327561378,
      "pose_rmse_dtheta": 0.13030192255973816,
      "pose_rmse_dx": 0.02439873293042183,
      "pose_rmse_dy": 0.033265840262174606,
      "pose_rmse_mean": 0.0626555010676384,
      "rmse_dtheta": 0.01711740531027317,
      "rmse_dx": 0.0029301398899406195,
      "rmse_dy": 0.002535605803132057,
      "rmse_mean": 0.007527717389166355,
      "rotation_flip": 0.004060089122503996,
      "sparse_tokens": 32201.0,
      "step": 6971,
      "turn_loss": 0.05052543431520462,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.32391748745586324,
      "grad_norm": 0.4912569224834442,
      "learning_rate": 3.8070759033106962e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.03256913647055626,
      "mae_dx": 0.013782747089862823,
      "mae_dy": 0.004865875467658043,
      "pose_mae_dtheta": 0.2742457389831543,
      "pose_mae_dx": 0.10509262979030609,
      "pose_mae_dy": 0.07321510463953018,
      "pose_rmse_dtheta": 0.4876983165740967,
      "pose_rmse_dx": 0.23278959095478058,
      "pose_rmse_dy": 0.17170745134353638,
      "pose_rmse_mean": 0.2973984479904175,
      "rmse_dtheta": 0.05158906430006027,
      "rmse_dx": 0.026641741394996643,
      "rmse_dy": 0.011279156431555748,
      "rmse_mean": 0.029836654663085938,
      "rotation_flip": 0.007585335057228804,
      "sparse_tokens": 13314.0,
      "step": 6972,
      "turn_loss": 0.34297534823417664,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.323963947221706,
      "grad_norm": 0.4832563102245331,
      "learning_rate": 3.8057919093961554e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.009367553517222404,
      "mae_dx": 0.0018275470938533545,
      "mae_dy": 0.0023449857253581285,
      "pose_mae_dtheta": 0.060501907020807266,
      "pose_mae_dx": 0.01823059283196926,
      "pose_mae_dy": 0.024442607536911964,
      "pose_rmse_dtheta": 0.16134695708751678,
      "pose_rmse_dx": 0.057088885456323624,
      "pose_rmse_dy": 0.06380288302898407,
      "pose_rmse_mean": 0.09407957643270493,
      "rmse_dtheta": 0.02129357121884823,
      "rmse_dx": 0.005461999215185642,
      "rmse_dy": 0.006028501782566309,
      "rmse_mean": 0.010928025469183922,
      "rotation_flip": 0.006674082484096289,
      "sparse_tokens": 32121.0,
      "step": 6973,
      "turn_loss": 0.07802348583936691,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3240104069875488,
      "grad_norm": 0.4457692503929138,
      "learning_rate": 3.8045079989932293e-06,
      "loss": 0.096,
      "mae_dtheta": 0.008574143052101135,
      "mae_dx": 0.0013971127336844802,
      "mae_dy": 0.0025039154570549726,
      "pose_mae_dtheta": 0.05545518547296524,
      "pose_mae_dx": 0.021920911967754364,
      "pose_mae_dy": 0.02675488032400608,
      "pose_rmse_dtheta": 0.12574346363544464,
      "pose_rmse_dx": 0.060345761477947235,
      "pose_rmse_dy": 0.06256186962127686,
      "pose_rmse_mean": 0.08288370072841644,
      "rmse_dtheta": 0.01752329245209694,
      "rmse_dx": 0.004291908349841833,
      "rmse_dy": 0.005534250754863024,
      "rmse_mean": 0.009116483852267265,
      "rotation_flip": 0.0020234722178429365,
      "sparse_tokens": 32073.0,
      "step": 6974,
      "turn_loss": 0.0711144283413887,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.32405686675339157,
      "grad_norm": 0.4649873971939087,
      "learning_rate": 3.8032241721916987e-06,
      "loss": 0.0965,
      "mae_dtheta": 0.009505880996584892,
      "mae_dx": 0.0015975814312696457,
      "mae_dy": 0.00266859820112586,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4649873673915863,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.2052459716797,
      "model/head/act_norm_mean": 108.10669191919192,
      "model/head/act_norm_min": 50.757266998291016,
      "model/head/act_over_embed": 74.29193079766449,
      "model/head/grad_frac": 0.10765410214662552,
      "model/head/grad_norm": 0.050057798624038696,
      "model/head/grad_zero_frac": 0.00019956394680775702,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7037809738005051,
      "model/head/update_ratio": 0.0008538177353329957,
      "model/head/weight_delta": 9.377102851867676,
      "model/head/weight_delta_rel": 0.16450215876102448,
      "model/head/weight_norm": 58.62820053100586,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4218592345714569,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4217964341905382,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42172297835350037,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.289862458496171,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0910206213593483,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04232344031333923,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5527256944444444,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013671856140717864,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0217509269714355,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09873002022504807,
      "model/modality_embedder.encoders.pose/weight_norm": 30.956615447998047,
      "model/modality_embedder/grad_frac": 0.0910206213593483,
      "model/modality_embedder/grad_norm": 0.04232344031333923,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5527256944444444,
      "model/modality_embedder/update_ratio": 0.0013671856140717864,
      "model/modality_embedder/weight_delta": 3.0217509269714355,
      "model/modality_embedder/weight_delta_rel": 0.09873002022504807,
      "model/modality_embedder/weight_norm": 30.956615447998047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.51380920410156,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.498078503286838,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.040876388549805,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.1480995399357,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07969153672456741,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03705555945634842,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003379196277819574,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013281996361911297,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4560494422912598,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08949992060661316,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.89908790588379,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.4583969116211,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.506022526855862,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.214767456054688,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.840768109452956,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0699375569820404,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03252008184790611,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010961475782096386,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1143107414245605,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10788215696811676,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.667612075805664,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.00656127929688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.401993646785314,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.162036895751953,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.143697213429764,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06470655649900436,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030087731778621674,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00030765816336497664,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009822164429351687,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.361248016357422,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1128644123673439,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.63248634338379,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.8108139038086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.187006473464805,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.386335372924805,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.37037473947729,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.059938400983810425,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.027870599180459976,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0003580939373932779,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009329986060038209,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8761770725250244,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09829408675432205,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.8720703125,
      "model/normalizer/grad_frac": 0.24240422248840332,
      "model/normalizer/grad_norm": 0.11271490156650543,
      "model/normalizer/grad_zero_frac": 0.00030370676540769637,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014350777491927147,
      "model/normalizer/weight_delta": 6.079828262329102,
      "model/normalizer/weight_delta_rel": 0.07830467075109482,
      "model/normalizer/weight_norm": 78.54271697998047,
      "pose_mae_dtheta": 0.057343147695064545,
      "pose_mae_dx": 0.018765870481729507,
      "pose_mae_dy": 0.02502226084470749,
      "pose_rmse_dtheta": 0.1301470398902893,
      "pose_rmse_dx": 0.049356311559677124,
      "pose_rmse_dy": 0.06611720472574234,
      "pose_rmse_mean": 0.08187352120876312,
      "rmse_dtheta": 0.02005649544298649,
      "rmse_dx": 0.004169366788119078,
      "rmse_dy": 0.00611147889867425,
      "rmse_mean": 0.010112447664141655,
      "rotation_flip": 0.005875871982425451,
      "sparse_tokens": 32121.0,
      "step": 6975,
      "turn_loss": 0.08241310715675354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.32410332651923435,
      "grad_norm": 0.42090335488319397,
      "learning_rate": 3.8019404290813456e-06,
      "loss": 0.1179,
      "mae_dtheta": 0.009530916810035706,
      "mae_dx": 0.0016969888238236308,
      "mae_dy": 0.001986094517633319,
      "pose_mae_dtheta": 0.06181209161877632,
      "pose_mae_dx": 0.021555032581090927,
      "pose_mae_dy": 0.023758184164762497,
      "pose_rmse_dtheta": 0.17304526269435883,
      "pose_rmse_dx": 0.0492691844701767,
      "pose_rmse_dy": 0.05807429179549217,
      "pose_rmse_mean": 0.09346291422843933,
      "rmse_dtheta": 0.02404903806746006,
      "rmse_dx": 0.004672455135732889,
      "rmse_dy": 0.004367700312286615,
      "rmse_mean": 0.01102973148226738,
      "rotation_flip": 0.0024610336404293776,
      "sparse_tokens": 32137.0,
      "step": 6976,
      "turn_loss": 0.08452004939317703,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.3241497862850771,
      "grad_norm": 0.7061689496040344,
      "learning_rate": 3.800656769751939e-06,
      "loss": 0.2091,
      "mae_dtheta": 0.034416381269693375,
      "mae_dx": 0.009813465178012848,
      "mae_dy": 0.008455160073935986,
      "pose_mae_dtheta": 0.2700452506542206,
      "pose_mae_dx": 0.07481992244720459,
      "pose_mae_dy": 0.0704149454832077,
      "pose_rmse_dtheta": 0.4825752079486847,
      "pose_rmse_dx": 0.16771069169044495,
      "pose_rmse_dy": 0.17736701667308807,
      "pose_rmse_mean": 0.27588433027267456,
      "rmse_dtheta": 0.05434039607644081,
      "rmse_dx": 0.019837653264403343,
      "rmse_dy": 0.019076691940426826,
      "rmse_mean": 0.03108491376042366,
      "rotation_flip": 0.021459227427840233,
      "sparse_tokens": 15801.0,
      "step": 6977,
      "turn_loss": 0.29667410254478455,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 37522.0,
      "epoch": 0.3241962460509199,
      "grad_norm": 0.46729153394699097,
      "learning_rate": 3.7993731942932517e-06,
      "loss": 0.1191,
      "mae_dtheta": 0.03557172790169716,
      "mae_dx": 0.01593577302992344,
      "mae_dy": 0.006990577559918165,
      "pose_mae_dtheta": 0.29277175664901733,
      "pose_mae_dx": 0.13667960464954376,
      "pose_mae_dy": 0.07995182275772095,
      "pose_rmse_dtheta": 0.48968371748924255,
      "pose_rmse_dx": 0.29082196950912476,
      "pose_rmse_dy": 0.20054692029953003,
      "pose_rmse_mean": 0.32701754570007324,
      "rmse_dtheta": 0.051666196435689926,
      "rmse_dx": 0.029221434146165848,
      "rmse_dy": 0.015129953622817993,
      "rmse_mean": 0.03200586140155792,
      "rotation_flip": 0.018299246206879616,
      "sparse_tokens": 29494.0,
      "step": 6978,
      "turn_loss": 0.32658109068870544,
      "turns": 116.0,
      "turns_per_sample": 116.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3242427058167627,
      "grad_norm": 0.3894067406654358,
      "learning_rate": 3.798089702795038e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.006181757431477308,
      "mae_dx": 0.00118833442684263,
      "mae_dy": 0.0015648609260097146,
      "pose_mae_dtheta": 0.03962317854166031,
      "pose_mae_dx": 0.015524591319262981,
      "pose_mae_dy": 0.01789599098265171,
      "pose_rmse_dtheta": 0.10826244950294495,
      "pose_rmse_dx": 0.03962666168808937,
      "pose_rmse_dy": 0.0426517017185688,
      "pose_rmse_mean": 0.0635136067867279,
      "rmse_dtheta": 0.016644204035401344,
      "rmse_dx": 0.003211766015738249,
      "rmse_dy": 0.0037789547350257635,
      "rmse_mean": 0.007878309115767479,
      "rotation_flip": 0.005610098131000996,
      "sparse_tokens": 32105.0,
      "step": 6979,
      "turn_loss": 0.05578417330980301,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34930.0,
      "epoch": 0.32428916558260545,
      "grad_norm": 0.5631922483444214,
      "learning_rate": 3.796806295347057e-06,
      "loss": 0.1461,
      "mae_dtheta": 0.03799569606781006,
      "mae_dx": 0.016086235642433167,
      "mae_dy": 0.005309704225510359,
      "pose_mae_dtheta": 0.30886584520339966,
      "pose_mae_dx": 0.12902696430683136,
      "pose_mae_dy": 0.06834664195775986,
      "pose_rmse_dtheta": 0.5425377488136292,
      "pose_rmse_dx": 0.27504557371139526,
      "pose_rmse_dy": 0.14761297404766083,
      "pose_rmse_mean": 0.3217321038246155,
      "rmse_dtheta": 0.056329041719436646,
      "rmse_dx": 0.02990497089922428,
      "rmse_dy": 0.00966776255518198,
      "rmse_mean": 0.03196725994348526,
      "rotation_flip": 0.014571948908269405,
      "sparse_tokens": 29067.0,
      "step": 6980,
      "turn_loss": 0.3472258150577545,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.32433562534844823,
      "grad_norm": 0.6843417286872864,
      "learning_rate": 3.7955229720390595e-06,
      "loss": 0.1383,
      "mae_dtheta": 0.03899765759706497,
      "mae_dx": 0.01481830794364214,
      "mae_dy": 0.0075371162965893745,
      "pose_mae_dtheta": 0.25322291254997253,
      "pose_mae_dx": 0.1358797252178192,
      "pose_mae_dy": 0.09109555929899216,
      "pose_rmse_dtheta": 0.4248746931552887,
      "pose_rmse_dx": 0.27420419454574585,
      "pose_rmse_dy": 0.1706085056066513,
      "pose_rmse_mean": 0.28989583253860474,
      "rmse_dtheta": 0.05309957638382912,
      "rmse_dx": 0.027371389791369438,
      "rmse_dy": 0.012006850913167,
      "rmse_mean": 0.030825939029455185,
      "rotation_flip": 0.007462686393409967,
      "sparse_tokens": 4257.0,
      "step": 6981,
      "turn_loss": 0.3363311290740967,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.324382085114291,
      "grad_norm": 0.4832926094532013,
      "learning_rate": 3.794239732960785e-06,
      "loss": 0.1182,
      "mae_dtheta": 0.04379216954112053,
      "mae_dx": 0.01247229240834713,
      "mae_dy": 0.008492231369018555,
      "pose_mae_dtheta": 0.30521097779273987,
      "pose_mae_dx": 0.09669537097215652,
      "pose_mae_dy": 0.0974968746304512,
      "pose_rmse_dtheta": 0.5256746411323547,
      "pose_rmse_dx": 0.2121138721704483,
      "pose_rmse_dy": 0.22300685942173004,
      "pose_rmse_mean": 0.32026511430740356,
      "rmse_dtheta": 0.06356817483901978,
      "rmse_dx": 0.02566858008503914,
      "rmse_dy": 0.01607598178088665,
      "rmse_mean": 0.03510424494743347,
      "rotation_flip": 0.017676766961812973,
      "sparse_tokens": 12182.0,
      "step": 6982,
      "turn_loss": 0.3260049819946289,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3244285448801338,
      "grad_norm": 0.3462522327899933,
      "learning_rate": 3.792956578201975e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.007656499743461609,
      "mae_dx": 0.0022706901654601097,
      "mae_dy": 0.0019339870195835829,
      "pose_mae_dtheta": 0.05341389775276184,
      "pose_mae_dx": 0.023218508809804916,
      "pose_mae_dy": 0.021110419183969498,
      "pose_rmse_dtheta": 0.12850095331668854,
      "pose_rmse_dx": 0.08281552046537399,
      "pose_rmse_dy": 0.05166952684521675,
      "pose_rmse_mean": 0.08766200393438339,
      "rmse_dtheta": 0.017788073047995567,
      "rmse_dx": 0.009023872204124928,
      "rmse_dy": 0.0061426847241818905,
      "rmse_mean": 0.010984877124428749,
      "rotation_flip": 0.003548895940184593,
      "sparse_tokens": 32153.0,
      "step": 6983,
      "turn_loss": 0.08311372995376587,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.32447500464597656,
      "grad_norm": 0.38838350772857666,
      "learning_rate": 3.791673507852359e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.043448321521282196,
      "mae_dx": 0.01763937622308731,
      "mae_dy": 0.006517285946756601,
      "pose_mae_dtheta": 0.3813214898109436,
      "pose_mae_dx": 0.13825826346874237,
      "pose_mae_dy": 0.08329354226589203,
      "pose_rmse_dtheta": 0.6093733906745911,
      "pose_rmse_dx": 0.2758534252643585,
      "pose_rmse_dy": 0.21284018456935883,
      "pose_rmse_mean": 0.36602234840393066,
      "rmse_dtheta": 0.061763565987348557,
      "rmse_dx": 0.031104709953069687,
      "rmse_dy": 0.013978686183691025,
      "rmse_mean": 0.03561565279960632,
      "rotation_flip": 0.014503817074000835,
      "sparse_tokens": 21089.0,
      "step": 6984,
      "turn_loss": 0.33311593532562256,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 35039.0,
      "epoch": 0.32452146441181934,
      "grad_norm": 0.7692632675170898,
      "learning_rate": 3.790390522001662e-06,
      "loss": 0.1817,
      "mae_dtheta": 0.029930397868156433,
      "mae_dx": 0.013660609722137451,
      "mae_dy": 0.006448064930737019,
      "pose_mae_dtheta": 0.23125766217708588,
      "pose_mae_dx": 0.09836949408054352,
      "pose_mae_dy": 0.07058875262737274,
      "pose_rmse_dtheta": 0.431321918964386,
      "pose_rmse_dx": 0.21907077729701996,
      "pose_rmse_dy": 0.18121391534805298,
      "pose_rmse_mean": 0.27720221877098083,
      "rmse_dtheta": 0.047620002180337906,
      "rmse_dx": 0.026409311220049858,
      "rmse_dy": 0.014194587245583534,
      "rmse_mean": 0.029407966881990433,
      "rotation_flip": 0.013897281140089035,
      "sparse_tokens": 27554.0,
      "step": 6985,
      "turn_loss": 0.286372572183609,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.32456792417766217,
      "grad_norm": 0.5657308101654053,
      "learning_rate": 3.789107620739606e-06,
      "loss": 0.1336,
      "mae_dtheta": 0.009739642031490803,
      "mae_dx": 0.002222514944151044,
      "mae_dy": 0.0019957590848207474,
      "pose_mae_dtheta": 0.07160291820764542,
      "pose_mae_dx": 0.026287084445357323,
      "pose_mae_dy": 0.026999713853001595,
      "pose_rmse_dtheta": 0.1461973339319229,
      "pose_rmse_dx": 0.06624660640954971,
      "pose_rmse_dy": 0.06437576562166214,
      "pose_rmse_mean": 0.09227323532104492,
      "rmse_dtheta": 0.019695695489645004,
      "rmse_dx": 0.006780899129807949,
      "rmse_dy": 0.004493210464715958,
      "rmse_mean": 0.010323269292712212,
      "rotation_flip": 0.004670912865549326,
      "sparse_tokens": 32121.0,
      "step": 6986,
      "turn_loss": 0.07317838072776794,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.32461438394350495,
      "grad_norm": 0.5862806439399719,
      "learning_rate": 3.787824804155903e-06,
      "loss": 0.1068,
      "mae_dtheta": 0.015242653898894787,
      "mae_dx": 0.001904478413052857,
      "mae_dy": 0.0038906768895685673,
      "pose_mae_dtheta": 0.10086894035339355,
      "pose_mae_dx": 0.03234436362981796,
      "pose_mae_dy": 0.041601985692977905,
      "pose_rmse_dtheta": 0.23010393977165222,
      "pose_rmse_dx": 0.07830608636140823,
      "pose_rmse_dy": 0.09000750631093979,
      "pose_rmse_mean": 0.13280585408210754,
      "rmse_dtheta": 0.028348485007882118,
      "rmse_dx": 0.00522021995857358,
      "rmse_dy": 0.0073333363980054855,
      "rmse_mean": 0.013634013943374157,
      "rotation_flip": 0.008417508564889431,
      "sparse_tokens": 32057.0,
      "step": 6987,
      "turn_loss": 0.1145588830113411,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.3246608437093477,
      "grad_norm": 0.47304874658584595,
      "learning_rate": 3.7865420723402635e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.03391188383102417,
      "mae_dx": 0.009446918033063412,
      "mae_dy": 0.007280956953763962,
      "pose_mae_dtheta": 0.2737923264503479,
      "pose_mae_dx": 0.08466923981904984,
      "pose_mae_dy": 0.09401477128267288,
      "pose_rmse_dtheta": 0.44728800654411316,
      "pose_rmse_dx": 0.14058686792850494,
      "pose_rmse_dy": 0.17172758281230927,
      "pose_rmse_mean": 0.25320082902908325,
      "rmse_dtheta": 0.04774948209524155,
      "rmse_dx": 0.01757604070007801,
      "rmse_dy": 0.012240893207490444,
      "rmse_mean": 0.025855472311377525,
      "rotation_flip": 0.029411764815449715,
      "sparse_tokens": 3683.0,
      "step": 6988,
      "turn_loss": 0.37576383352279663,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.3247073034751905,
      "grad_norm": 0.683059811592102,
      "learning_rate": 3.7852594253823868e-06,
      "loss": 0.1406,
      "mae_dtheta": 0.037424396723508835,
      "mae_dx": 0.0070508685894310474,
      "mae_dy": 0.010439848527312279,
      "pose_mae_dtheta": 0.320684015750885,
      "pose_mae_dx": 0.07473909109830856,
      "pose_mae_dy": 0.09177423268556595,
      "pose_rmse_dtheta": 0.5612636804580688,
      "pose_rmse_dx": 0.16531676054000854,
      "pose_rmse_dy": 0.18821310997009277,
      "pose_rmse_mean": 0.3049311935901642,
      "rmse_dtheta": 0.05682723969221115,
      "rmse_dx": 0.01598336361348629,
      "rmse_dy": 0.020920278504490852,
      "rmse_mean": 0.03124362789094448,
      "rotation_flip": 0.011278195306658745,
      "sparse_tokens": 4078.0,
      "step": 6989,
      "turn_loss": 0.2708684206008911,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3247537632410333,
      "grad_norm": 0.5630152225494385,
      "learning_rate": 3.783976863371972e-06,
      "loss": 0.1005,
      "mae_dtheta": 0.010938391089439392,
      "mae_dx": 0.0021612655837088823,
      "mae_dy": 0.003221780527383089,
      "pose_mae_dtheta": 0.07896772027015686,
      "pose_mae_dx": 0.02440139278769493,
      "pose_mae_dy": 0.025510549545288086,
      "pose_rmse_dtheta": 0.21284964680671692,
      "pose_rmse_dx": 0.06650196015834808,
      "pose_rmse_dy": 0.057942938059568405,
      "pose_rmse_mean": 0.11243151128292084,
      "rmse_dtheta": 0.02470007911324501,
      "rmse_dx": 0.006461549084633589,
      "rmse_dy": 0.007641229312866926,
      "rmse_mean": 0.012934286147356033,
      "rotation_flip": 0.004072398412972689,
      "sparse_tokens": 32057.0,
      "step": 6990,
      "turn_loss": 0.07943923026323318,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.32480022300687605,
      "grad_norm": 0.9460392594337463,
      "learning_rate": 3.782694386398706e-06,
      "loss": 0.2767,
      "mae_dtheta": 0.030015064403414726,
      "mae_dx": 0.008153527043759823,
      "mae_dy": 0.004613976925611496,
      "pose_mae_dtheta": 0.23701763153076172,
      "pose_mae_dx": 0.07486586272716522,
      "pose_mae_dy": 0.05232740193605423,
      "pose_rmse_dtheta": 0.4079953730106354,
      "pose_rmse_dx": 0.1549975723028183,
      "pose_rmse_dy": 0.12775211036205292,
      "pose_rmse_mean": 0.230248361825943,
      "rmse_dtheta": 0.04493389278650284,
      "rmse_dx": 0.017823059111833572,
      "rmse_dy": 0.009888791479170322,
      "rmse_mean": 0.024215249344706535,
      "rotation_flip": 0.007312614470720291,
      "sparse_tokens": 8598.0,
      "step": 6991,
      "turn_loss": 0.2270340472459793,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.32484668277271883,
      "grad_norm": 0.7398468852043152,
      "learning_rate": 3.781411994552275e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.02320173569023609,
      "mae_dx": 0.007973127998411655,
      "mae_dy": 0.0037318735849112272,
      "pose_mae_dtheta": 0.16028641164302826,
      "pose_mae_dx": 0.06645567715167999,
      "pose_mae_dy": 0.03989049419760704,
      "pose_rmse_dtheta": 0.29608237743377686,
      "pose_rmse_dx": 0.16458310186862946,
      "pose_rmse_dy": 0.08366885781288147,
      "pose_rmse_mean": 0.18144476413726807,
      "rmse_dtheta": 0.03835069015622139,
      "rmse_dx": 0.01891240105032921,
      "rmse_dy": 0.007249440532177687,
      "rmse_mean": 0.021504176780581474,
      "rotation_flip": 0.007299270015209913,
      "sparse_tokens": 14807.0,
      "step": 6992,
      "turn_loss": 0.19815796613693237,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3248931425385616,
      "grad_norm": 0.6438508629798889,
      "learning_rate": 3.7801296879223594e-06,
      "loss": 0.0967,
      "mae_dtheta": 0.010848034173250198,
      "mae_dx": 0.0013759320136159658,
      "mae_dy": 0.0021787555888295174,
      "pose_mae_dtheta": 0.07256798446178436,
      "pose_mae_dx": 0.02080097794532776,
      "pose_mae_dy": 0.029416393488645554,
      "pose_rmse_dtheta": 0.16356761753559113,
      "pose_rmse_dx": 0.05033117160201073,
      "pose_rmse_dy": 0.06919670104980469,
      "pose_rmse_mean": 0.09436516463756561,
      "rmse_dtheta": 0.02217053808271885,
      "rmse_dx": 0.0042509580962359905,
      "rmse_dy": 0.0043005309998989105,
      "rmse_mean": 0.010240675881505013,
      "rotation_flip": 0.002199413487687707,
      "sparse_tokens": 32105.0,
      "step": 6993,
      "turn_loss": 0.09189826995134354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.3249396023044044,
      "grad_norm": 0.6185568571090698,
      "learning_rate": 3.7788474665986267e-06,
      "loss": 0.1361,
      "mae_dtheta": 0.03911162167787552,
      "mae_dx": 0.010479837656021118,
      "mae_dy": 0.004228905308991671,
      "pose_mae_dtheta": 0.30772829055786133,
      "pose_mae_dx": 0.0753052830696106,
      "pose_mae_dy": 0.0589761957526207,
      "pose_rmse_dtheta": 0.5480861663818359,
      "pose_rmse_dx": 0.16100908815860748,
      "pose_rmse_dy": 0.1514112800359726,
      "pose_rmse_mean": 0.28683552145957947,
      "rmse_dtheta": 0.0588102862238884,
      "rmse_dx": 0.020897330716252327,
      "rmse_dy": 0.008079958148300648,
      "rmse_mean": 0.029262525960803032,
      "rotation_flip": 0.017989417538046837,
      "sparse_tokens": 16415.0,
      "step": 6994,
      "turn_loss": 0.2522195875644684,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 32763.0,
      "epoch": 0.32498606207024716,
      "grad_norm": 0.5228668451309204,
      "learning_rate": 3.7775653306707487e-06,
      "loss": 0.1788,
      "mae_dtheta": 0.0325787290930748,
      "mae_dx": 0.008682643063366413,
      "mae_dy": 0.004127900581806898,
      "pose_mae_dtheta": 0.2548885941505432,
      "pose_mae_dx": 0.06409118324518204,
      "pose_mae_dy": 0.04277070611715317,
      "pose_rmse_dtheta": 0.5091282725334167,
      "pose_rmse_dx": 0.1537417769432068,
      "pose_rmse_dy": 0.10453575104475021,
      "pose_rmse_mean": 0.2558019459247589,
      "rmse_dtheta": 0.053261466324329376,
      "rmse_dx": 0.018818078562617302,
      "rmse_dy": 0.00896152202039957,
      "rmse_mean": 0.027013689279556274,
      "rotation_flip": 0.010526316240429878,
      "sparse_tokens": 27547.0,
      "step": 6995,
      "turn_loss": 0.2265263944864273,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.32503252183608994,
      "grad_norm": 0.802984893321991,
      "learning_rate": 3.776283280228381e-06,
      "loss": 0.1278,
      "mae_dtheta": 0.05207836255431175,
      "mae_dx": 0.016140034422278404,
      "mae_dy": 0.015112868510186672,
      "pose_mae_dtheta": 0.412306010723114,
      "pose_mae_dx": 0.08667317777872086,
      "pose_mae_dy": 0.16956883668899536,
      "pose_rmse_dtheta": 0.6834107041358948,
      "pose_rmse_dx": 0.19285516440868378,
      "pose_rmse_dy": 0.3656095266342163,
      "pose_rmse_mean": 0.41395848989486694,
      "rmse_dtheta": 0.0712215006351471,
      "rmse_dx": 0.029879944398999214,
      "rmse_dy": 0.030574394389986992,
      "rmse_mean": 0.04389194771647453,
      "rotation_flip": 0.01515151560306549,
      "sparse_tokens": 4151.0,
      "step": 6996,
      "turn_loss": 0.7720719575881958,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.3250789816019327,
      "grad_norm": 0.4476626217365265,
      "learning_rate": 3.775001315361183e-06,
      "loss": 0.1159,
      "mae_dtheta": 0.035601772367954254,
      "mae_dx": 0.00962261762470007,
      "mae_dy": 0.006326858885586262,
      "pose_mae_dtheta": 0.32467207312583923,
      "pose_mae_dx": 0.08814316987991333,
      "pose_mae_dy": 0.09848694503307343,
      "pose_rmse_dtheta": 0.522190511226654,
      "pose_rmse_dx": 0.17442427575588226,
      "pose_rmse_dy": 0.17980782687664032,
      "pose_rmse_mean": 0.2921409010887146,
      "rmse_dtheta": 0.052873384207487106,
      "rmse_dx": 0.019961366429924965,
      "rmse_dy": 0.01049020979553461,
      "rmse_mean": 0.027774987742304802,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 3973.0,
      "step": 6997,
      "turn_loss": 0.25053566694259644,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3251254413677755,
      "grad_norm": 0.45724236965179443,
      "learning_rate": 3.773719436158798e-06,
      "loss": 0.1058,
      "mae_dtheta": 0.007812120020389557,
      "mae_dx": 0.0013895692536607385,
      "mae_dy": 0.0015387166058644652,
      "pose_mae_dtheta": 0.055148378014564514,
      "pose_mae_dx": 0.015501230955123901,
      "pose_mae_dy": 0.020638907328248024,
      "pose_rmse_dtheta": 0.14112192392349243,
      "pose_rmse_dx": 0.040996003895998,
      "pose_rmse_dy": 0.04643720015883446,
      "pose_rmse_mean": 0.07618504762649536,
      "rmse_dtheta": 0.017925167456269264,
      "rmse_dx": 0.004602889530360699,
      "rmse_dy": 0.003406102303415537,
      "rmse_mean": 0.00864471960812807,
      "rotation_flip": 0.0037515631411224604,
      "sparse_tokens": 32105.0,
      "step": 6998,
      "turn_loss": 0.06361900269985199,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.32517190113361827,
      "grad_norm": 0.4156791567802429,
      "learning_rate": 3.772437642710871e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.03229488432407379,
      "mae_dx": 0.009372182190418243,
      "mae_dy": 0.004037301056087017,
      "pose_mae_dtheta": 0.24113163352012634,
      "pose_mae_dx": 0.07458247244358063,
      "pose_mae_dy": 0.03169826418161392,
      "pose_rmse_dtheta": 0.43342429399490356,
      "pose_rmse_dx": 0.17367464303970337,
      "pose_rmse_dy": 0.07700525969266891,
      "pose_rmse_mean": 0.22803473472595215,
      "rmse_dtheta": 0.051916904747486115,
      "rmse_dx": 0.01981101743876934,
      "rmse_dy": 0.010028225369751453,
      "rmse_mean": 0.02725205197930336,
      "rotation_flip": 0.0076388888992369175,
      "sparse_tokens": 21503.0,
      "step": 6999,
      "turn_loss": 0.2629711627960205,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.32521836089946105,
      "grad_norm": 0.4483910799026489,
      "learning_rate": 3.7711559351070403e-06,
      "loss": 0.1222,
      "mae_dtheta": 0.009789767675101757,
      "mae_dx": 0.001104647759348154,
      "mae_dy": 0.0022309464402496815,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4483911395072937,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 168.4936981201172,
      "model/head/act_norm_mean": 109.25978535353535,
      "model/head/act_norm_min": 66.2761001586914,
      "model/head/act_over_embed": 75.08434740117612,
      "model/head/grad_frac": 0.09707166254520416,
      "model/head/grad_norm": 0.043526072055101395,
      "model/head/grad_zero_frac": 0.0001932185114128515,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7126193576388888,
      "model/head/update_ratio": 0.000742378004360944,
      "model/head/weight_delta": 9.385984420776367,
      "model/head/weight_delta_rel": 0.16465796530246735,
      "model/head/weight_norm": 58.6306037902832,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42186281085014343,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4217955898231184,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4217202961444855,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.289861878238975,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10692446678876877,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04794398322701454,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5230523767605634,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015487392665818334,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0217604637145996,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09873033314943314,
      "model/modality_embedder.encoders.pose/weight_norm": 30.9567813873291,
      "model/modality_embedder/grad_frac": 0.10692446678876877,
      "model/modality_embedder/grad_norm": 0.04794398322701454,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5230523767605634,
      "model/modality_embedder/update_ratio": 0.0015487392665818334,
      "model/modality_embedder/weight_delta": 3.0217604637145996,
      "model/modality_embedder/weight_delta_rel": 0.09873033314943314,
      "model/modality_embedder/weight_norm": 30.9567813873291,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.14723205566406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.497359507776174,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.033612251281738,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.147605439489432,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06760531663894653,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.030313624069094658,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010865213116630912,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.460012912750244,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08964435756206512,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.899703979492188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.96304321289062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.46171035754369,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.4447603225708,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.810316371844568,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06709808111190796,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030086185783147812,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010140675585716963,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.119520425796509,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10806262493133545,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.6688175201416,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.88142395019531,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.274526014109348,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.408872604370117,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.056100262884062,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07041524350643158,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.031573571264743805,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010306821204721928,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.36690092086792,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11305423080921173,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.633665084838867,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.62776184082031,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.040554353054354,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.61324405670166,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.269731471224873,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07600103318691254,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03407818824052811,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011407573474571109,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8808865547180176,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0984550341963768,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.873302459716797,
      "model/normalizer/grad_frac": 0.3134724497795105,
      "model/normalizer/grad_norm": 0.14055827260017395,
      "model/normalizer/grad_zero_frac": 0.00021743986872024834,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017895417986437678,
      "model/normalizer/weight_delta": 6.089888095855713,
      "model/normalizer/weight_delta_rel": 0.07843423634767532,
      "model/normalizer/weight_norm": 78.54428100585938,
      "pose_mae_dtheta": 0.05906236916780472,
      "pose_mae_dx": 0.015503118745982647,
      "pose_mae_dy": 0.028112944215536118,
      "pose_rmse_dtheta": 0.10680679976940155,
      "pose_rmse_dx": 0.03997058421373367,
      "pose_rmse_dy": 0.05822324380278587,
      "pose_rmse_mean": 0.06833355128765106,
      "rmse_dtheta": 0.017058145254850388,
      "rmse_dx": 0.0034312554635107517,
      "rmse_dy": 0.004520243965089321,
      "rmse_mean": 0.008336547762155533,
      "rotation_flip": 0.005609573796391487,
      "sparse_tokens": 32025.0,
      "step": 7000,
      "turn_loss": 0.07225301861763,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.32521836089946105,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3090628981590271,
      "eval_objectnav_nopose_mae_dtheta": 0.04004954919219017,
      "eval_objectnav_nopose_mae_dx": 0.01352164801210165,
      "eval_objectnav_nopose_mae_dy": 0.005164354108273983,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32342082262039185,
      "eval_objectnav_nopose_pose_mae_dx": 0.10761161893606186,
      "eval_objectnav_nopose_pose_mae_dy": 0.0574316568672657,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5420307517051697,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2337617576122284,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13433589041233063,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30337613821029663,
      "eval_objectnav_nopose_rmse_dtheta": 0.05778741091489792,
      "eval_objectnav_nopose_rmse_dx": 0.02609497867524624,
      "eval_objectnav_nopose_rmse_dy": 0.010413308627903461,
      "eval_objectnav_nopose_rmse_mean": 0.0314319021999836,
      "eval_objectnav_nopose_rotation_flip": 0.015526164323091507,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3090628981590271,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 7000
    },
    {
      "epoch": 0.32521836089946105,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27881327271461487,
      "eval_objectnav_pose_mae_dtheta": 0.035025447607040405,
      "eval_objectnav_pose_mae_dx": 0.011248280294239521,
      "eval_objectnav_pose_mae_dy": 0.004678478930145502,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26442280411720276,
      "eval_objectnav_pose_pose_mae_dx": 0.08713214099407196,
      "eval_objectnav_pose_pose_mae_dy": 0.049077145755290985,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4659067988395691,
      "eval_objectnav_pose_pose_rmse_dx": 0.2013818472623825,
      "eval_objectnav_pose_pose_rmse_dy": 0.11732271313667297,
      "eval_objectnav_pose_pose_rmse_mean": 0.2615371346473694,
      "eval_objectnav_pose_rmse_dtheta": 0.052713267505168915,
      "eval_objectnav_pose_rmse_dx": 0.02329917997121811,
      "eval_objectnav_pose_rmse_dy": 0.009714595973491669,
      "eval_objectnav_pose_rmse_mean": 0.028575681149959564,
      "eval_objectnav_pose_rotation_flip": 0.01449618861079216,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27881327271461487,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 7000
    },
    {
      "epoch": 0.32521836089946105,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09026908129453659,
      "eval_pointnav_mae_dtheta": 0.010479672811925411,
      "eval_pointnav_mae_dx": 0.002385801402851939,
      "eval_pointnav_mae_dy": 0.0024772314354777336,
      "eval_pointnav_pose_mae_dtheta": 0.07327099144458771,
      "eval_pointnav_pose_mae_dx": 0.02682776376605034,
      "eval_pointnav_pose_mae_dy": 0.026721058413386345,
      "eval_pointnav_pose_rmse_dtheta": 0.2086026519536972,
      "eval_pointnav_pose_rmse_dx": 0.07985910028219223,
      "eval_pointnav_pose_rmse_dy": 0.07704045623540878,
      "eval_pointnav_pose_rmse_mean": 0.12183406949043274,
      "eval_pointnav_rmse_dtheta": 0.025633063167333603,
      "eval_pointnav_rmse_dx": 0.007519483100622892,
      "eval_pointnav_rmse_dy": 0.006550963968038559,
      "eval_pointnav_rmse_mean": 0.01323450356721878,
      "eval_pointnav_rotation_flip": 0.004673029761761427,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09026908129453659,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 7000
    },
    {
      "epoch": 0.32521836089946105,
      "eval_loss": 0.22604841738939285,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3090628981590271,
      "eval_objectnav_nopose_mae_dtheta": 0.04004954919219017,
      "eval_objectnav_nopose_mae_dx": 0.01352164801210165,
      "eval_objectnav_nopose_mae_dy": 0.005164354108273983,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32342082262039185,
      "eval_objectnav_nopose_pose_mae_dx": 0.10761161893606186,
      "eval_objectnav_nopose_pose_mae_dy": 0.0574316568672657,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5420307517051697,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2337617576122284,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13433589041233063,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30337613821029663,
      "eval_objectnav_nopose_rmse_dtheta": 0.05778741091489792,
      "eval_objectnav_nopose_rmse_dx": 0.02609497867524624,
      "eval_objectnav_nopose_rmse_dy": 0.010413308627903461,
      "eval_objectnav_nopose_rmse_mean": 0.0314319021999836,
      "eval_objectnav_nopose_rotation_flip": 0.015526164323091507,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3090628981590271,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27881327271461487,
      "eval_objectnav_pose_mae_dtheta": 0.035025447607040405,
      "eval_objectnav_pose_mae_dx": 0.011248280294239521,
      "eval_objectnav_pose_mae_dy": 0.004678478930145502,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26442280411720276,
      "eval_objectnav_pose_pose_mae_dx": 0.08713214099407196,
      "eval_objectnav_pose_pose_mae_dy": 0.049077145755290985,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4659067988395691,
      "eval_objectnav_pose_pose_rmse_dx": 0.2013818472623825,
      "eval_objectnav_pose_pose_rmse_dy": 0.11732271313667297,
      "eval_objectnav_pose_pose_rmse_mean": 0.2615371346473694,
      "eval_objectnav_pose_rmse_dtheta": 0.052713267505168915,
      "eval_objectnav_pose_rmse_dx": 0.02329917997121811,
      "eval_objectnav_pose_rmse_dy": 0.009714595973491669,
      "eval_objectnav_pose_rmse_mean": 0.028575681149959564,
      "eval_objectnav_pose_rotation_flip": 0.01449618861079216,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27881327271461487,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09026908129453659,
      "eval_pointnav_mae_dtheta": 0.010479672811925411,
      "eval_pointnav_mae_dx": 0.002385801402851939,
      "eval_pointnav_mae_dy": 0.0024772314354777336,
      "eval_pointnav_pose_mae_dtheta": 0.07327099144458771,
      "eval_pointnav_pose_mae_dx": 0.02682776376605034,
      "eval_pointnav_pose_mae_dy": 0.026721058413386345,
      "eval_pointnav_pose_rmse_dtheta": 0.2086026519536972,
      "eval_pointnav_pose_rmse_dx": 0.07985910028219223,
      "eval_pointnav_pose_rmse_dy": 0.07704045623540878,
      "eval_pointnav_pose_rmse_mean": 0.12183406949043274,
      "eval_pointnav_rmse_dtheta": 0.025633063167333603,
      "eval_pointnav_rmse_dx": 0.007519483100622892,
      "eval_pointnav_rmse_dy": 0.006550963968038559,
      "eval_pointnav_rmse_mean": 0.01323450356721878,
      "eval_pointnav_rotation_flip": 0.004673029761761427,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09026908129453659,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 7000
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.3252648206653038,
      "grad_norm": 0.4745507836341858,
      "learning_rate": 3.769874313436933e-06,
      "loss": 0.0732,
      "mae_dtheta": 0.031218037009239197,
      "mae_dx": 0.010925758630037308,
      "mae_dy": 0.009217195212841034,
      "pose_mae_dtheta": 0.2802921235561371,
      "pose_mae_dx": 0.1061519905924797,
      "pose_mae_dy": 0.13459359109401703,
      "pose_rmse_dtheta": 0.43413323163986206,
      "pose_rmse_dx": 0.22204138338565826,
      "pose_rmse_dy": 0.24018721282482147,
      "pose_rmse_mean": 0.29878729581832886,
      "rmse_dtheta": 0.04540689289569855,
      "rmse_dx": 0.024489875882864,
      "rmse_dy": 0.014470787718892097,
      "rmse_mean": 0.028122520074248314,
      "rotation_flip": 0.013289036229252815,
      "sparse_tokens": 5770.0,
      "step": 7001,
      "turn_loss": 0.28039517998695374,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.32531128043114665,
      "grad_norm": 0.620241641998291,
      "learning_rate": 3.768592777790177e-06,
      "loss": 0.1536,
      "mae_dtheta": 0.03646198660135269,
      "mae_dx": 0.009670299477875233,
      "mae_dy": 0.009657282382249832,
      "pose_mae_dtheta": 0.2869969308376312,
      "pose_mae_dx": 0.09298726916313171,
      "pose_mae_dy": 0.11541839689016342,
      "pose_rmse_dtheta": 0.5242370367050171,
      "pose_rmse_dx": 0.2405683845281601,
      "pose_rmse_dy": 0.282662570476532,
      "pose_rmse_mean": 0.349155992269516,
      "rmse_dtheta": 0.05518670380115509,
      "rmse_dx": 0.020395224913954735,
      "rmse_dy": 0.02030866965651512,
      "rmse_mean": 0.0319635346531868,
      "rotation_flip": 0.00542005430907011,
      "sparse_tokens": 12842.0,
      "step": 7002,
      "turn_loss": 0.340136855840683,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.32535774019698943,
      "grad_norm": 1.0063775777816772,
      "learning_rate": 3.7673113282563883e-06,
      "loss": 0.2714,
      "mae_dtheta": 0.029873771592974663,
      "mae_dx": 0.010767406783998013,
      "mae_dy": 0.006130762863904238,
      "pose_mae_dtheta": 0.18277880549430847,
      "pose_mae_dx": 0.08746924251317978,
      "pose_mae_dy": 0.0766163319349289,
      "pose_rmse_dtheta": 0.33990123867988586,
      "pose_rmse_dx": 0.2184726744890213,
      "pose_rmse_dy": 0.17041708528995514,
      "pose_rmse_mean": 0.2429303377866745,
      "rmse_dtheta": 0.04844231158494949,
      "rmse_dx": 0.024184590205550194,
      "rmse_dy": 0.010821694508194923,
      "rmse_mean": 0.027816198766231537,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 14745.0,
      "step": 7003,
      "turn_loss": 0.2735111117362976,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 34716.0,
      "epoch": 0.3254041999628322,
      "grad_norm": 0.4663277566432953,
      "learning_rate": 3.7660299649251797e-06,
      "loss": 0.1755,
      "mae_dtheta": 0.028996121138334274,
      "mae_dx": 0.011919785290956497,
      "mae_dy": 0.0047218697145581245,
      "pose_mae_dtheta": 0.23620860278606415,
      "pose_mae_dx": 0.0895196795463562,
      "pose_mae_dy": 0.04471172019839287,
      "pose_rmse_dtheta": 0.3886951804161072,
      "pose_rmse_dx": 0.19287358224391937,
      "pose_rmse_dy": 0.12487710267305374,
      "pose_rmse_mean": 0.23548196256160736,
      "rmse_dtheta": 0.043573372066020966,
      "rmse_dx": 0.02365010976791382,
      "rmse_dy": 0.010614478960633278,
      "rmse_mean": 0.025945987552404404,
      "rotation_flip": 0.023296447470784187,
      "sparse_tokens": 26273.0,
      "step": 7004,
      "turn_loss": 0.24767157435417175,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.325450659728675,
      "grad_norm": 0.46440812945365906,
      "learning_rate": 3.7647486878861585e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.011982162483036518,
      "mae_dx": 0.0018817274831235409,
      "mae_dy": 0.0027079961728304625,
      "pose_mae_dtheta": 0.08002010732889175,
      "pose_mae_dx": 0.02303260751068592,
      "pose_mae_dy": 0.03052881732583046,
      "pose_rmse_dtheta": 0.22548924386501312,
      "pose_rmse_dx": 0.06392939388751984,
      "pose_rmse_dy": 0.08786332607269287,
      "pose_rmse_mean": 0.12576065957546234,
      "rmse_dtheta": 0.027467947453260422,
      "rmse_dx": 0.006637901533395052,
      "rmse_dy": 0.007021547760814428,
      "rmse_mean": 0.013709131628274918,
      "rotation_flip": 0.006158583331853151,
      "sparse_tokens": 32073.0,
      "step": 7005,
      "turn_loss": 0.09481965750455856,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.32549711949451776,
      "grad_norm": 0.4611327350139618,
      "learning_rate": 3.7634674972289227e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.009433627128601074,
      "mae_dx": 0.0020407841075211763,
      "mae_dy": 0.0013080600183457136,
      "pose_mae_dtheta": 0.07018706947565079,
      "pose_mae_dx": 0.01973256841301918,
      "pose_mae_dy": 0.012593497522175312,
      "pose_rmse_dtheta": 0.22013205289840698,
      "pose_rmse_dx": 0.04741645231842995,
      "pose_rmse_dy": 0.03416227176785469,
      "pose_rmse_mean": 0.10057026147842407,
      "rmse_dtheta": 0.026898298412561417,
      "rmse_dx": 0.005877086892724037,
      "rmse_dy": 0.0037601045332849026,
      "rmse_mean": 0.012178497388958931,
      "rotation_flip": 0.005027933046221733,
      "sparse_tokens": 32153.0,
      "step": 7006,
      "turn_loss": 0.07857546955347061,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28785.0,
      "epoch": 0.32554357926036054,
      "grad_norm": 0.7257512807846069,
      "learning_rate": 3.7621863930430715e-06,
      "loss": 0.283,
      "mae_dtheta": 0.0324326790869236,
      "mae_dx": 0.011770619079470634,
      "mae_dy": 0.004658485297113657,
      "pose_mae_dtheta": 0.2600294351577759,
      "pose_mae_dx": 0.09065306931734085,
      "pose_mae_dy": 0.05924251303076744,
      "pose_rmse_dtheta": 0.46435239911079407,
      "pose_rmse_dx": 0.21825657784938812,
      "pose_rmse_dy": 0.13723838329315186,
      "pose_rmse_mean": 0.2732824683189392,
      "rmse_dtheta": 0.05082313343882561,
      "rmse_dx": 0.02477709949016571,
      "rmse_dy": 0.008927817456424236,
      "rmse_mean": 0.028176017105579376,
      "rotation_flip": 0.021311474964022636,
      "sparse_tokens": 22278.0,
      "step": 7007,
      "turn_loss": 0.2585037350654602,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3255900390262033,
      "grad_norm": 0.48658937215805054,
      "learning_rate": 3.7609053754181873e-06,
      "loss": 0.0767,
      "mae_dtheta": 0.006845599506050348,
      "mae_dx": 0.0009856211254373193,
      "mae_dy": 0.0014223656617105007,
      "pose_mae_dtheta": 0.03966788575053215,
      "pose_mae_dx": 0.009394923225045204,
      "pose_mae_dy": 0.017089584842324257,
      "pose_rmse_dtheta": 0.07728826999664307,
      "pose_rmse_dx": 0.020653530955314636,
      "pose_rmse_dy": 0.03522104397416115,
      "pose_rmse_mean": 0.04438761621713638,
      "rmse_dtheta": 0.013915146701037884,
      "rmse_dx": 0.0029558269307017326,
      "rmse_dy": 0.0034707512240856886,
      "rmse_mean": 0.006780575029551983,
      "rotation_flip": 0.004177744034677744,
      "sparse_tokens": 32137.0,
      "step": 7008,
      "turn_loss": 0.049463268369436264,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15544.0,
      "epoch": 0.3256364987920461,
      "grad_norm": 0.49152466654777527,
      "learning_rate": 3.7596244444438577e-06,
      "loss": 0.1154,
      "mae_dtheta": 0.037508394569158554,
      "mae_dx": 0.011611663736402988,
      "mae_dy": 0.004478076938539743,
      "pose_mae_dtheta": 0.28163453936576843,
      "pose_mae_dx": 0.09102410078048706,
      "pose_mae_dy": 0.05383977293968201,
      "pose_rmse_dtheta": 0.5335537195205688,
      "pose_rmse_dx": 0.1975593864917755,
      "pose_rmse_dy": 0.12246863543987274,
      "pose_rmse_mean": 0.2845272421836853,
      "rmse_dtheta": 0.05884215980768204,
      "rmse_dx": 0.023835022002458572,
      "rmse_dy": 0.009509054012596607,
      "rmse_mean": 0.030728748068213463,
      "rotation_flip": 0.004464285913854837,
      "sparse_tokens": 12909.0,
      "step": 7009,
      "turn_loss": 0.2862495481967926,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.32568295855788887,
      "grad_norm": 0.5150886178016663,
      "learning_rate": 3.758343600209654e-06,
      "loss": 0.0856,
      "mae_dtheta": 0.00757236685603857,
      "mae_dx": 0.0014112782664597034,
      "mae_dy": 0.001754379947669804,
      "pose_mae_dtheta": 0.05049966648221016,
      "pose_mae_dx": 0.015672331675887108,
      "pose_mae_dy": 0.022387249395251274,
      "pose_rmse_dtheta": 0.10542207211256027,
      "pose_rmse_dx": 0.03841148316860199,
      "pose_rmse_dy": 0.05124473199248314,
      "pose_rmse_mean": 0.06502609699964523,
      "rmse_dtheta": 0.016439266502857208,
      "rmse_dx": 0.004108515568077564,
      "rmse_dy": 0.0035180614795535803,
      "rmse_mean": 0.008021947927772999,
      "rotation_flip": 0.0015432098880410194,
      "sparse_tokens": 32137.0,
      "step": 7010,
      "turn_loss": 0.05905194580554962,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.32572941832373165,
      "grad_norm": 0.5687174797058105,
      "learning_rate": 3.7570628428051494e-06,
      "loss": 0.1349,
      "mae_dtheta": 0.03303832933306694,
      "mae_dx": 0.008161945268511772,
      "mae_dy": 0.005222187377512455,
      "pose_mae_dtheta": 0.25190043449401855,
      "pose_mae_dx": 0.06266427785158157,
      "pose_mae_dy": 0.07385065406560898,
      "pose_rmse_dtheta": 0.4403010308742523,
      "pose_rmse_dx": 0.1429353654384613,
      "pose_rmse_dy": 0.14939892292022705,
      "pose_rmse_mean": 0.24421177804470062,
      "rmse_dtheta": 0.05086559057235718,
      "rmse_dx": 0.019468044862151146,
      "rmse_dy": 0.009134062565863132,
      "rmse_mean": 0.02648923359811306,
      "rotation_flip": 0.0171358622610569,
      "sparse_tokens": 14420.0,
      "step": 7011,
      "turn_loss": 0.285866916179657,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3257758780895744,
      "grad_norm": 0.38744112849235535,
      "learning_rate": 3.755782172319909e-06,
      "loss": 0.0803,
      "mae_dtheta": 0.010976620018482208,
      "mae_dx": 0.0021718961652368307,
      "mae_dy": 0.0021420596167445183,
      "pose_mae_dtheta": 0.07291323691606522,
      "pose_mae_dx": 0.023969536647200584,
      "pose_mae_dy": 0.022657202556729317,
      "pose_rmse_dtheta": 0.20686347782611847,
      "pose_rmse_dx": 0.058657579123973846,
      "pose_rmse_dy": 0.055980391800403595,
      "pose_rmse_mean": 0.10716714709997177,
      "rmse_dtheta": 0.026476629078388214,
      "rmse_dx": 0.006026236340403557,
      "rmse_dy": 0.004867968149483204,
      "rmse_mean": 0.012456945143640041,
      "rotation_flip": 0.0020920501556247473,
      "sparse_tokens": 32105.0,
      "step": 7012,
      "turn_loss": 0.11276755481958389,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.3258223378554172,
      "grad_norm": 0.5308036804199219,
      "learning_rate": 3.7545015888434873e-06,
      "loss": 0.1028,
      "mae_dtheta": 0.03201064094901085,
      "mae_dx": 0.013007551431655884,
      "mae_dy": 0.00743074482306838,
      "pose_mae_dtheta": 0.24911871552467346,
      "pose_mae_dx": 0.0970233902335167,
      "pose_mae_dy": 0.09548452496528625,
      "pose_rmse_dtheta": 0.3796639144420624,
      "pose_rmse_dx": 0.1904705911874771,
      "pose_rmse_dy": 0.1977861374616623,
      "pose_rmse_mean": 0.25597357749938965,
      "rmse_dtheta": 0.045586828142404556,
      "rmse_dx": 0.02501007728278637,
      "rmse_dy": 0.01335406769067049,
      "rmse_mean": 0.027983658015727997,
      "rotation_flip": 0.021276595070958138,
      "sparse_tokens": 7083.0,
      "step": 7013,
      "turn_loss": 0.35566601157188416,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.32586879762126,
      "grad_norm": 0.5281067490577698,
      "learning_rate": 3.75322109246544e-06,
      "loss": 0.1213,
      "mae_dtheta": 0.01642690598964691,
      "mae_dx": 0.001883925055153668,
      "mae_dy": 0.0037312631029635668,
      "pose_mae_dtheta": 0.11080566793680191,
      "pose_mae_dx": 0.032279372215270996,
      "pose_mae_dy": 0.045739300549030304,
      "pose_rmse_dtheta": 0.2414640337228775,
      "pose_rmse_dx": 0.0803699940443039,
      "pose_rmse_dy": 0.1036025732755661,
      "pose_rmse_mean": 0.14181220531463623,
      "rmse_dtheta": 0.031629372388124466,
      "rmse_dx": 0.006211861502379179,
      "rmse_dy": 0.007776579353958368,
      "rmse_mean": 0.01520593836903572,
      "rotation_flip": 0.0077795786783099174,
      "sparse_tokens": 32057.0,
      "step": 7014,
      "turn_loss": 0.13984991610050201,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.32591525738710275,
      "grad_norm": 0.4552627205848694,
      "learning_rate": 3.7519406832753085e-06,
      "loss": 0.0729,
      "mae_dtheta": 0.008228802122175694,
      "mae_dx": 0.0009038234711624682,
      "mae_dy": 0.0008735121227800846,
      "pose_mae_dtheta": 0.060403332114219666,
      "pose_mae_dx": 0.010672403499484062,
      "pose_mae_dy": 0.014791839756071568,
      "pose_rmse_dtheta": 0.22427719831466675,
      "pose_rmse_dx": 0.033290695399045944,
      "pose_rmse_dy": 0.04365598410367966,
      "pose_rmse_mean": 0.10040795803070068,
      "rmse_dtheta": 0.025171175599098206,
      "rmse_dx": 0.0031016867142170668,
      "rmse_dy": 0.0022806390188634396,
      "rmse_mean": 0.010184500366449356,
      "rotation_flip": 0.001958224456757307,
      "sparse_tokens": 32057.0,
      "step": 7015,
      "turn_loss": 0.04153642803430557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.32596171715294553,
      "grad_norm": 0.5159859657287598,
      "learning_rate": 3.750660361362637e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.008477558381855488,
      "mae_dx": 0.0013388642109930515,
      "mae_dy": 0.0021624919027090073,
      "pose_mae_dtheta": 0.055096518248319626,
      "pose_mae_dx": 0.02060355618596077,
      "pose_mae_dy": 0.025298887863755226,
      "pose_rmse_dtheta": 0.13498325645923615,
      "pose_rmse_dx": 0.05696675926446915,
      "pose_rmse_dy": 0.07009908556938171,
      "pose_rmse_mean": 0.08734970539808273,
      "rmse_dtheta": 0.018952500075101852,
      "rmse_dx": 0.0035004608798772097,
      "rmse_dy": 0.0049956911243498325,
      "rmse_mean": 0.009149551391601562,
      "rotation_flip": 0.0015100038144737482,
      "sparse_tokens": 32105.0,
      "step": 7016,
      "turn_loss": 0.07196668535470963,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3260081769187883,
      "grad_norm": 0.5410805940628052,
      "learning_rate": 3.749380126816955e-06,
      "loss": 0.1178,
      "mae_dtheta": 0.004883332643657923,
      "mae_dx": 0.0009569081012159586,
      "mae_dy": 0.0009172071004286408,
      "pose_mae_dtheta": 0.03103245608508587,
      "pose_mae_dx": 0.009528163820505142,
      "pose_mae_dy": 0.011595215648412704,
      "pose_rmse_dtheta": 0.07445880025625229,
      "pose_rmse_dx": 0.024080580100417137,
      "pose_rmse_dy": 0.02840748243033886,
      "pose_rmse_mean": 0.04231562465429306,
      "rmse_dtheta": 0.012065197341144085,
      "rmse_dx": 0.0031548691913485527,
      "rmse_dy": 0.0019838891457766294,
      "rmse_mean": 0.005734651815146208,
      "rotation_flip": 0.0021910604555159807,
      "sparse_tokens": 32137.0,
      "step": 7017,
      "turn_loss": 0.03645717352628708,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3260546366846311,
      "grad_norm": 0.45939183235168457,
      "learning_rate": 3.748099979727792e-06,
      "loss": 0.0753,
      "mae_dtheta": 0.008880550973117352,
      "mae_dx": 0.0016214803326874971,
      "mae_dy": 0.0018200197955593467,
      "pose_mae_dtheta": 0.05769916996359825,
      "pose_mae_dx": 0.016758501529693604,
      "pose_mae_dy": 0.021105872467160225,
      "pose_rmse_dtheta": 0.1367103010416031,
      "pose_rmse_dx": 0.05269637703895569,
      "pose_rmse_dy": 0.05469200760126114,
      "pose_rmse_mean": 0.08136623352766037,
      "rmse_dtheta": 0.02016531676054001,
      "rmse_dx": 0.006220001261681318,
      "rmse_dy": 0.005443563684821129,
      "rmse_mean": 0.010609626770019531,
      "rotation_flip": 0.004472272004932165,
      "sparse_tokens": 32089.0,
      "step": 7018,
      "turn_loss": 0.0728173479437828,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3261010964504739,
      "grad_norm": 0.36292293667793274,
      "learning_rate": 3.7468199201846724e-06,
      "loss": 0.084,
      "mae_dtheta": 0.005801594350486994,
      "mae_dx": 0.0013819322921335697,
      "mae_dy": 0.0010972149902954698,
      "pose_mae_dtheta": 0.03913343325257301,
      "pose_mae_dx": 0.012812770903110504,
      "pose_mae_dy": 0.012222614139318466,
      "pose_rmse_dtheta": 0.11715579032897949,
      "pose_rmse_dx": 0.030241576954722404,
      "pose_rmse_dy": 0.02752056159079075,
      "pose_rmse_mean": 0.058305978775024414,
      "rmse_dtheta": 0.015102840028703213,
      "rmse_dx": 0.0038391186390072107,
      "rmse_dy": 0.0025282830465584993,
      "rmse_mean": 0.007156747858971357,
      "rotation_flip": 0.005673758685588837,
      "sparse_tokens": 32153.0,
      "step": 7019,
      "turn_loss": 0.0513245053589344,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.3261475562163167,
      "grad_norm": 0.6238887906074524,
      "learning_rate": 3.7455399482771047e-06,
      "loss": 0.1699,
      "mae_dtheta": 0.03397546336054802,
      "mae_dx": 0.011241494677960873,
      "mae_dy": 0.0033567817881703377,
      "pose_mae_dtheta": 0.29614943265914917,
      "pose_mae_dx": 0.0919964537024498,
      "pose_mae_dy": 0.0404081754386425,
      "pose_rmse_dtheta": 0.5654945373535156,
      "pose_rmse_dx": 0.2114979326725006,
      "pose_rmse_dy": 0.0902692973613739,
      "pose_rmse_mean": 0.2890872657299042,
      "rmse_dtheta": 0.05479656532406807,
      "rmse_dx": 0.022672535851597786,
      "rmse_dy": 0.006179908290505409,
      "rmse_mean": 0.027883004397153854,
      "rotation_flip": 0.013597032986581326,
      "sparse_tokens": 14448.0,
      "step": 7020,
      "turn_loss": 0.22640091180801392,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.32619401598215947,
      "grad_norm": 0.5570374727249146,
      "learning_rate": 3.7442600640946045e-06,
      "loss": 0.1405,
      "mae_dtheta": 0.030935313552618027,
      "mae_dx": 0.01106882095336914,
      "mae_dy": 0.00690699415281415,
      "pose_mae_dtheta": 0.21714764833450317,
      "pose_mae_dx": 0.09659303724765778,
      "pose_mae_dy": 0.06385115534067154,
      "pose_rmse_dtheta": 0.41624289751052856,
      "pose_rmse_dx": 0.1895790994167328,
      "pose_rmse_dy": 0.13864634931087494,
      "pose_rmse_mean": 0.2481561154127121,
      "rmse_dtheta": 0.0481615848839283,
      "rmse_dx": 0.022655382752418518,
      "rmse_dy": 0.012907029129564762,
      "rmse_mean": 0.027907997369766235,
      "rotation_flip": 0.009661835618317127,
      "sparse_tokens": 13821.0,
      "step": 7021,
      "turn_loss": 0.28502848744392395,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.32624047574800225,
      "grad_norm": 0.4005657136440277,
      "learning_rate": 3.7429802677266714e-06,
      "loss": 0.1102,
      "mae_dtheta": 0.012198349460959435,
      "mae_dx": 0.0016394162084907293,
      "mae_dy": 0.003117078449577093,
      "pose_mae_dtheta": 0.07581093162298203,
      "pose_mae_dx": 0.025308702141046524,
      "pose_mae_dy": 0.03702637180685997,
      "pose_rmse_dtheta": 0.1551564633846283,
      "pose_rmse_dx": 0.06238308176398277,
      "pose_rmse_dy": 0.07540182024240494,
      "pose_rmse_mean": 0.09764712303876877,
      "rmse_dtheta": 0.022652192041277885,
      "rmse_dx": 0.005222420208156109,
      "rmse_dy": 0.00630291597917676,
      "rmse_mean": 0.011392509564757347,
      "rotation_flip": 0.0072289155796170235,
      "sparse_tokens": 32089.0,
      "step": 7022,
      "turn_loss": 0.09846249967813492,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.326286935513845,
      "grad_norm": 1.1458797454833984,
      "learning_rate": 3.7417005592628027e-06,
      "loss": 0.2567,
      "mae_dtheta": 0.02999241277575493,
      "mae_dx": 0.009078252129256725,
      "mae_dy": 0.005659194663167,
      "pose_mae_dtheta": 0.2149265855550766,
      "pose_mae_dx": 0.09060242772102356,
      "pose_mae_dy": 0.07653579860925674,
      "pose_rmse_dtheta": 0.42608004808425903,
      "pose_rmse_dx": 0.18222200870513916,
      "pose_rmse_dy": 0.15976490080356598,
      "pose_rmse_mean": 0.2560223340988159,
      "rmse_dtheta": 0.04862038418650627,
      "rmse_dx": 0.020699085667729378,
      "rmse_dy": 0.010184172540903091,
      "rmse_mean": 0.026501214131712914,
      "rotation_flip": 0.008888889104127884,
      "sparse_tokens": 7944.0,
      "step": 7023,
      "turn_loss": 0.247465580701828,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.3263333952796878,
      "grad_norm": 0.6648589372634888,
      "learning_rate": 3.740420938792489e-06,
      "loss": 0.1394,
      "mae_dtheta": 0.028057098388671875,
      "mae_dx": 0.009994626976549625,
      "mae_dy": 0.003471778240054846,
      "pose_mae_dtheta": 0.21874397993087769,
      "pose_mae_dx": 0.08256655931472778,
      "pose_mae_dy": 0.05160936340689659,
      "pose_rmse_dtheta": 0.3957078158855438,
      "pose_rmse_dx": 0.19561615586280823,
      "pose_rmse_dy": 0.1220049262046814,
      "pose_rmse_mean": 0.23777630925178528,
      "rmse_dtheta": 0.0455571748316288,
      "rmse_dx": 0.022695643827319145,
      "rmse_dy": 0.006198444869369268,
      "rmse_mean": 0.0248170867562294,
      "rotation_flip": 0.010647737421095371,
      "sparse_tokens": 21105.0,
      "step": 7024,
      "turn_loss": 0.18858368694782257,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3263798550455306,
      "grad_norm": 0.40457653999328613,
      "learning_rate": 3.7391414064052138e-06,
      "loss": 0.0799,
      "mae_dtheta": 0.011297320015728474,
      "mae_dx": 0.0021450435742735863,
      "mae_dy": 0.0028916692826896906,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.40457651019096375,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.25912475585938,
      "model/head/act_norm_mean": 105.88993450126263,
      "model/head/act_norm_min": 55.6543083190918,
      "model/head/act_over_embed": 72.76855434645357,
      "model/head/grad_frac": 0.09388367831707001,
      "model/head/grad_norm": 0.03798313066363335,
      "model/head/grad_zero_frac": 0.0001776721910573542,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6986071654040404,
      "model/head/update_ratio": 0.0006478146533481777,
      "model/head/weight_delta": 9.394364356994629,
      "model/head/weight_delta_rel": 0.16480498015880585,
      "model/head/weight_norm": 58.632713317871094,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42179328203201294,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4217198134509757,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4216366112232208,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.289809804006609,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08996719121932983,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03639861196279526,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5555830376637555,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011757775209844112,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0216190814971924,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09872571378946304,
      "model/modality_embedder.encoders.pose/weight_norm": 30.957056045532227,
      "model/modality_embedder/grad_frac": 0.08996719121932983,
      "model/modality_embedder/grad_norm": 0.03639861196279526,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5555830376637555,
      "model/modality_embedder/update_ratio": 0.0011757775209844112,
      "model/modality_embedder/weight_delta": 3.0216190814971924,
      "model/modality_embedder/weight_delta_rel": 0.09872571378946304,
      "model/modality_embedder/weight_norm": 30.957056045532227,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.20310974121094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.29973094035594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.045894622802734,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.011793237730448,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05753154680132866,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.023275911808013916,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00034800678258761764,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008342467481270432,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.463968515396118,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08978849649429321,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.9005126953125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.95991516113281,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.3099522005772,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.520565032958984,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.706026745594947,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06003067269921303,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02428700029850006,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008185621700249612,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.124445676803589,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.108233243227005,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.670318603515625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.93839263916016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.223199254449256,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.922852516174316,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.02082803311695,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06736176460981369,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.027252987027168274,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008895993232727051,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.3719630241394043,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11322420835494995,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.6351261138916,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.70378875732422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.0166195687029,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.011702537536621,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.253283263337572,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08009964972734451,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.032406438142061234,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010847633238881826,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8856284618377686,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0986170843243599,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.87420082092285,
      "model/normalizer/grad_frac": 0.2951352596282959,
      "model/normalizer/grad_norm": 0.11940479278564453,
      "model/normalizer/grad_zero_frac": 0.00023989289184100926,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0015201925998553634,
      "model/normalizer/weight_delta": 6.099565029144287,
      "model/normalizer/weight_delta_rel": 0.07855886965990067,
      "model/normalizer/weight_norm": 78.54582977294922,
      "pose_mae_dtheta": 0.07619119435548782,
      "pose_mae_dx": 0.026284903287887573,
      "pose_mae_dy": 0.027987008914351463,
      "pose_rmse_dtheta": 0.1819310039281845,
      "pose_rmse_dx": 0.06928270310163498,
      "pose_rmse_dy": 0.06251105666160583,
      "pose_rmse_mean": 0.10457491874694824,
      "rmse_dtheta": 0.02337050624191761,
      "rmse_dx": 0.005899809300899506,
      "rmse_dy": 0.006827368400990963,
      "rmse_mean": 0.012032561004161835,
      "rotation_flip": 0.0026666666381061077,
      "sparse_tokens": 32153.0,
      "step": 7025,
      "turn_loss": 0.10557793080806732,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.32642631481137335,
      "grad_norm": 0.6163409352302551,
      "learning_rate": 3.7378619621904593e-06,
      "loss": 0.0791,
      "mae_dtheta": 0.020223382860422134,
      "mae_dx": 0.005463018082082272,
      "mae_dy": 0.00291549158282578,
      "pose_mae_dtheta": 0.15533925592899323,
      "pose_mae_dx": 0.037848155945539474,
      "pose_mae_dy": 0.029406575486063957,
      "pose_rmse_dtheta": 0.3401350677013397,
      "pose_rmse_dx": 0.10834787040948868,
      "pose_rmse_dy": 0.06278467923402786,
      "pose_rmse_mean": 0.1704225391149521,
      "rmse_dtheta": 0.03493126481771469,
      "rmse_dx": 0.01498907245695591,
      "rmse_dy": 0.006491572596132755,
      "rmse_mean": 0.018803969025611877,
      "rotation_flip": 0.0,
      "sparse_tokens": 3737.0,
      "step": 7026,
      "turn_loss": 0.2081432342529297,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 28227.0,
      "epoch": 0.32647277457721613,
      "grad_norm": 0.5734794735908508,
      "learning_rate": 3.7365826062376933e-06,
      "loss": 0.1601,
      "mae_dtheta": 0.036065489053726196,
      "mae_dx": 0.015144669450819492,
      "mae_dy": 0.004830599762499332,
      "pose_mae_dtheta": 0.29838913679122925,
      "pose_mae_dx": 0.12342429161071777,
      "pose_mae_dy": 0.06094564124941826,
      "pose_rmse_dtheta": 0.5010574460029602,
      "pose_rmse_dx": 0.2639363408088684,
      "pose_rmse_dy": 0.15356968343257904,
      "pose_rmse_mean": 0.30618783831596375,
      "rmse_dtheta": 0.054193537682294846,
      "rmse_dx": 0.02812664397060871,
      "rmse_dy": 0.009621230885386467,
      "rmse_mean": 0.030647139996290207,
      "rotation_flip": 0.014026402495801449,
      "sparse_tokens": 22073.0,
      "step": 7027,
      "turn_loss": 0.28850725293159485,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.3265192343430589,
      "grad_norm": 0.7854410409927368,
      "learning_rate": 3.7353033386363857e-06,
      "loss": 0.2757,
      "mae_dtheta": 0.036949582397937775,
      "mae_dx": 0.012270385399460793,
      "mae_dy": 0.006297553423792124,
      "pose_mae_dtheta": 0.2576765716075897,
      "pose_mae_dx": 0.09944617003202438,
      "pose_mae_dy": 0.064054936170578,
      "pose_rmse_dtheta": 0.4570237994194031,
      "pose_rmse_dx": 0.20935176312923431,
      "pose_rmse_dy": 0.21160639822483063,
      "pose_rmse_mean": 0.292660653591156,
      "rmse_dtheta": 0.055787354707717896,
      "rmse_dx": 0.024251114577054977,
      "rmse_dy": 0.017220890149474144,
      "rmse_mean": 0.03241978958249092,
      "rotation_flip": 0.006345177534967661,
      "sparse_tokens": 15372.0,
      "step": 7028,
      "turn_loss": 0.29740387201309204,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.3265656941089017,
      "grad_norm": 0.6917206645011902,
      "learning_rate": 3.7340241594759917e-06,
      "loss": 0.1264,
      "mae_dtheta": 0.03543296828866005,
      "mae_dx": 0.011816740967333317,
      "mae_dy": 0.005076717585325241,
      "pose_mae_dtheta": 0.288499653339386,
      "pose_mae_dx": 0.10183217376470566,
      "pose_mae_dy": 0.04095438867807388,
      "pose_rmse_dtheta": 0.47553128004074097,
      "pose_rmse_dx": 0.20834992825984955,
      "pose_rmse_dy": 0.09225181490182877,
      "pose_rmse_mean": 0.258711040019989,
      "rmse_dtheta": 0.052322447299957275,
      "rmse_dx": 0.023010017350316048,
      "rmse_dy": 0.00965495128184557,
      "rmse_mean": 0.028329139575362206,
      "rotation_flip": 0.023255813866853714,
      "sparse_tokens": 7579.0,
      "step": 7029,
      "turn_loss": 0.2564919888973236,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.32661215387474446,
      "grad_norm": 0.4475390613079071,
      "learning_rate": 3.732745068845969e-06,
      "loss": 0.0816,
      "mae_dtheta": 0.007330958265811205,
      "mae_dx": 0.002282031811773777,
      "mae_dy": 0.00254572881385684,
      "pose_mae_dtheta": 0.048438865691423416,
      "pose_mae_dx": 0.02560015209019184,
      "pose_mae_dy": 0.020214712247252464,
      "pose_rmse_dtheta": 0.10862569510936737,
      "pose_rmse_dx": 0.07924340665340424,
      "pose_rmse_dy": 0.042218033224344254,
      "pose_rmse_mean": 0.07669571042060852,
      "rmse_dtheta": 0.016323011368513107,
      "rmse_dx": 0.0069643971510231495,
      "rmse_dy": 0.006787956692278385,
      "rmse_mean": 0.01002512127161026,
      "rotation_flip": 0.0057026478461921215,
      "sparse_tokens": 32105.0,
      "step": 7030,
      "turn_loss": 0.07505583018064499,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.32665861364058724,
      "grad_norm": 0.8333654403686523,
      "learning_rate": 3.731466066835765e-06,
      "loss": 0.1555,
      "mae_dtheta": 0.0423392653465271,
      "mae_dx": 0.019989125430583954,
      "mae_dy": 0.005766970571130514,
      "pose_mae_dtheta": 0.3423212766647339,
      "pose_mae_dx": 0.14871348440647125,
      "pose_mae_dy": 0.08811365813016891,
      "pose_rmse_dtheta": 0.5319628119468689,
      "pose_rmse_dx": 0.28934445977211,
      "pose_rmse_dy": 0.18620966374874115,
      "pose_rmse_mean": 0.33583900332450867,
      "rmse_dtheta": 0.058314282447099686,
      "rmse_dx": 0.03439982607960701,
      "rmse_dy": 0.009929466061294079,
      "rmse_mean": 0.034214526414871216,
      "rotation_flip": 0.017369726672768593,
      "sparse_tokens": 6761.0,
      "step": 7031,
      "turn_loss": 0.3509376049041748,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.32670507340643,
      "grad_norm": 0.5789505243301392,
      "learning_rate": 3.7301871535348176e-06,
      "loss": 0.1699,
      "mae_dtheta": 0.00730159180238843,
      "mae_dx": 0.00155299948528409,
      "mae_dy": 0.0017003124812617898,
      "pose_mae_dtheta": 0.050543367862701416,
      "pose_mae_dx": 0.019889382645487785,
      "pose_mae_dy": 0.0172017440199852,
      "pose_rmse_dtheta": 0.13722403347492218,
      "pose_rmse_dx": 0.06255582720041275,
      "pose_rmse_dy": 0.04745301976799965,
      "pose_rmse_mean": 0.08241096138954163,
      "rmse_dtheta": 0.01802651584148407,
      "rmse_dx": 0.004401270300149918,
      "rmse_dy": 0.0047788904048502445,
      "rmse_mean": 0.00906889233738184,
      "rotation_flip": 0.005052631720900536,
      "sparse_tokens": 32153.0,
      "step": 7032,
      "turn_loss": 0.06183230131864548,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3267515331722728,
      "grad_norm": 0.49340716004371643,
      "learning_rate": 3.7289083290325668e-06,
      "loss": 0.0885,
      "mae_dtheta": 0.01031454000622034,
      "mae_dx": 0.00194651132915169,
      "mae_dy": 0.002963913371786475,
      "pose_mae_dtheta": 0.069228395819664,
      "pose_mae_dx": 0.02669914998114109,
      "pose_mae_dy": 0.0280090793967247,
      "pose_rmse_dtheta": 0.13590383529663086,
      "pose_rmse_dx": 0.0718727633357048,
      "pose_rmse_dy": 0.06062119081616402,
      "pose_rmse_mean": 0.08946593850851059,
      "rmse_dtheta": 0.019954845309257507,
      "rmse_dx": 0.005163404159247875,
      "rmse_dy": 0.00673843827098608,
      "rmse_mean": 0.010618897154927254,
      "rotation_flip": 0.004758667666465044,
      "sparse_tokens": 32105.0,
      "step": 7033,
      "turn_loss": 0.08861800283193588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.32679799293811557,
      "grad_norm": 0.7415701150894165,
      "learning_rate": 3.7276295934184357e-06,
      "loss": 0.1471,
      "mae_dtheta": 0.027260376140475273,
      "mae_dx": 0.007653469685465097,
      "mae_dy": 0.003653221530839801,
      "pose_mae_dtheta": 0.199909508228302,
      "pose_mae_dx": 0.058726176619529724,
      "pose_mae_dy": 0.02991926297545433,
      "pose_rmse_dtheta": 0.3691120147705078,
      "pose_rmse_dx": 0.12204699218273163,
      "pose_rmse_dy": 0.07438308745622635,
      "pose_rmse_mean": 0.18851403892040253,
      "rmse_dtheta": 0.04516517370939255,
      "rmse_dx": 0.015796814113855362,
      "rmse_dy": 0.008781501092016697,
      "rmse_mean": 0.02324783056974411,
      "rotation_flip": 0.009630818851292133,
      "sparse_tokens": 11351.0,
      "step": 7034,
      "turn_loss": 0.20439252257347107,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.3268444527039584,
      "grad_norm": 1.180681586265564,
      "learning_rate": 3.726350946781853e-06,
      "loss": 0.244,
      "mae_dtheta": 0.028265342116355896,
      "mae_dx": 0.014913827180862427,
      "mae_dy": 0.009997113607823849,
      "pose_mae_dtheta": 0.18799014389514923,
      "pose_mae_dx": 0.11649787425994873,
      "pose_mae_dy": 0.13437820971012115,
      "pose_rmse_dtheta": 0.3020637333393097,
      "pose_rmse_dx": 0.23867131769657135,
      "pose_rmse_dy": 0.26709678769111633,
      "pose_rmse_mean": 0.26927730441093445,
      "rmse_dtheta": 0.04091581702232361,
      "rmse_dx": 0.027718214318156242,
      "rmse_dy": 0.017872238531708717,
      "rmse_mean": 0.028835423290729523,
      "rotation_flip": 0.014950166456401348,
      "sparse_tokens": 12294.0,
      "step": 7035,
      "turn_loss": 0.2867450714111328,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 29522.0,
      "epoch": 0.3268909124698012,
      "grad_norm": 0.47007322311401367,
      "learning_rate": 3.72507238921223e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.029007717967033386,
      "mae_dx": 0.007568980101495981,
      "mae_dy": 0.0050170146860182285,
      "pose_mae_dtheta": 0.2077864557504654,
      "pose_mae_dx": 0.06719299405813217,
      "pose_mae_dy": 0.06160738319158554,
      "pose_rmse_dtheta": 0.3569953143596649,
      "pose_rmse_dx": 0.1504799723625183,
      "pose_rmse_dy": 0.13720069825649261,
      "pose_rmse_mean": 0.21489199995994568,
      "rmse_dtheta": 0.04402938485145569,
      "rmse_dx": 0.017457371577620506,
      "rmse_dy": 0.008999280631542206,
      "rmse_mean": 0.023495346307754517,
      "rotation_flip": 0.010183298960328102,
      "sparse_tokens": 23386.0,
      "step": 7036,
      "turn_loss": 0.22141878306865692,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.32693737223564395,
      "grad_norm": 0.4417251944541931,
      "learning_rate": 3.7237939207989793e-06,
      "loss": 0.0802,
      "mae_dtheta": 0.012607975862920284,
      "mae_dx": 0.0016254009678959846,
      "mae_dy": 0.0034441554453223944,
      "pose_mae_dtheta": 0.08161526918411255,
      "pose_mae_dx": 0.023363523185253143,
      "pose_mae_dy": 0.038559313863515854,
      "pose_rmse_dtheta": 0.18293653428554535,
      "pose_rmse_dx": 0.056062307208776474,
      "pose_rmse_dy": 0.09406957030296326,
      "pose_rmse_mean": 0.11102281510829926,
      "rmse_dtheta": 0.025754414498806,
      "rmse_dx": 0.003901074407622218,
      "rmse_dy": 0.007366067264229059,
      "rmse_mean": 0.012340518645942211,
      "rotation_flip": 0.004186795558780432,
      "sparse_tokens": 32121.0,
      "step": 7037,
      "turn_loss": 0.10325109958648682,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.32698383200148673,
      "grad_norm": 0.6515077352523804,
      "learning_rate": 3.722515541631506e-06,
      "loss": 0.1399,
      "mae_dtheta": 0.008049559779465199,
      "mae_dx": 0.0012439271667972207,
      "mae_dy": 0.0021784876007586718,
      "pose_mae_dtheta": 0.05067453533411026,
      "pose_mae_dx": 0.019017281010746956,
      "pose_mae_dy": 0.025866473093628883,
      "pose_rmse_dtheta": 0.11777330935001373,
      "pose_rmse_dx": 0.0496501550078392,
      "pose_rmse_dy": 0.06545254588127136,
      "pose_rmse_mean": 0.0776253342628479,
      "rmse_dtheta": 0.01853136345744133,
      "rmse_dx": 0.0039195409044623375,
      "rmse_dy": 0.004703355021774769,
      "rmse_mean": 0.009051419794559479,
      "rotation_flip": 0.006810897495597601,
      "sparse_tokens": 32073.0,
      "step": 7038,
      "turn_loss": 0.06999003887176514,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3270302917673295,
      "grad_norm": 0.6306215524673462,
      "learning_rate": 3.721237251799206e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.011603498831391335,
      "mae_dx": 0.002457598689943552,
      "mae_dy": 0.003489795373752713,
      "pose_mae_dtheta": 0.08162552863359451,
      "pose_mae_dx": 0.029061295092105865,
      "pose_mae_dy": 0.03503980487585068,
      "pose_rmse_dtheta": 0.17798419296741486,
      "pose_rmse_dx": 0.07201143354177475,
      "pose_rmse_dy": 0.0812261775135994,
      "pose_rmse_mean": 0.1104072630405426,
      "rmse_dtheta": 0.024757007136940956,
      "rmse_dx": 0.007251708302646875,
      "rmse_dy": 0.008201226592063904,
      "rmse_mean": 0.013403314165771008,
      "rotation_flip": 0.0036912751384079456,
      "sparse_tokens": 32153.0,
      "step": 7039,
      "turn_loss": 0.11195843666791916,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3270767515331723,
      "grad_norm": 0.9294576644897461,
      "learning_rate": 3.7199590513914717e-06,
      "loss": 0.157,
      "mae_dtheta": 0.0063330791890621185,
      "mae_dx": 0.0017886419082060456,
      "mae_dy": 0.0011350176064297557,
      "pose_mae_dtheta": 0.0444495864212513,
      "pose_mae_dx": 0.01624961569905281,
      "pose_mae_dy": 0.015005218796432018,
      "pose_rmse_dtheta": 0.11857527494430542,
      "pose_rmse_dx": 0.04831172898411751,
      "pose_rmse_dy": 0.03985639661550522,
      "pose_rmse_mean": 0.06891446560621262,
      "rmse_dtheta": 0.015552547760307789,
      "rmse_dx": 0.006591504439711571,
      "rmse_dy": 0.002770884893834591,
      "rmse_mean": 0.008304979652166367,
      "rotation_flip": 0.0012787723680958152,
      "sparse_tokens": 32089.0,
      "step": 7040,
      "turn_loss": 0.054522816091775894,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.32712321129901506,
      "grad_norm": 0.5475347638130188,
      "learning_rate": 3.7186809404976877e-06,
      "loss": 0.1019,
      "mae_dtheta": 0.008387071080505848,
      "mae_dx": 0.0014852480962872505,
      "mae_dy": 0.0015688476851209998,
      "pose_mae_dtheta": 0.05292243883013725,
      "pose_mae_dx": 0.01932903192937374,
      "pose_mae_dy": 0.02165251225233078,
      "pose_rmse_dtheta": 0.1303565502166748,
      "pose_rmse_dx": 0.04969147965312004,
      "pose_rmse_dy": 0.06475276499986649,
      "pose_rmse_mean": 0.08160027116537094,
      "rmse_dtheta": 0.019846143200993538,
      "rmse_dx": 0.0045525915920734406,
      "rmse_dy": 0.003887450322508812,
      "rmse_mean": 0.009428728371858597,
      "rotation_flip": 0.0029658921994268894,
      "sparse_tokens": 32121.0,
      "step": 7041,
      "turn_loss": 0.0738561600446701,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.32716967106485784,
      "grad_norm": 0.5477965474128723,
      "learning_rate": 3.7174029192072337e-06,
      "loss": 0.0957,
      "mae_dtheta": 0.005704610608518124,
      "mae_dx": 0.0010164751438423991,
      "mae_dy": 0.0013017934979870915,
      "pose_mae_dtheta": 0.034459248185157776,
      "pose_mae_dx": 0.011335981078445911,
      "pose_mae_dy": 0.01622720994055271,
      "pose_rmse_dtheta": 0.0791875571012497,
      "pose_rmse_dx": 0.02765016257762909,
      "pose_rmse_dy": 0.035451583564281464,
      "pose_rmse_mean": 0.04742977023124695,
      "rmse_dtheta": 0.013548529706895351,
      "rmse_dx": 0.0031036813743412495,
      "rmse_dy": 0.002696227515116334,
      "rmse_mean": 0.0064494796097278595,
      "rotation_flip": 0.003284072270616889,
      "sparse_tokens": 32121.0,
      "step": 7042,
      "turn_loss": 0.04728338494896889,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3272161308307006,
      "grad_norm": 0.49456173181533813,
      "learning_rate": 3.716124987609481e-06,
      "loss": 0.0936,
      "mae_dtheta": 0.010133674368262291,
      "mae_dx": 0.0014798881020396948,
      "mae_dy": 0.0008249570964835584,
      "pose_mae_dtheta": 0.08116764575242996,
      "pose_mae_dx": 0.01199151761829853,
      "pose_mae_dy": 0.012071576900780201,
      "pose_rmse_dtheta": 0.28680965304374695,
      "pose_rmse_dx": 0.027099359780550003,
      "pose_rmse_dy": 0.03906528651714325,
      "pose_rmse_mean": 0.1176581010222435,
      "rmse_dtheta": 0.031346846371889114,
      "rmse_dx": 0.004239798057824373,
      "rmse_dy": 0.0024816200602799654,
      "rmse_mean": 0.012689421884715557,
      "rotation_flip": 0.002707092557102442,
      "sparse_tokens": 32201.0,
      "step": 7043,
      "turn_loss": 0.06166031211614609,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.3272625905965434,
      "grad_norm": 0.6178603172302246,
      "learning_rate": 3.7148471457937963e-06,
      "loss": 0.1365,
      "mae_dtheta": 0.037918783724308014,
      "mae_dx": 0.016419939696788788,
      "mae_dy": 0.00396773824468255,
      "pose_mae_dtheta": 0.27231115102767944,
      "pose_mae_dx": 0.12660452723503113,
      "pose_mae_dy": 0.04202957823872566,
      "pose_rmse_dtheta": 0.46462637186050415,
      "pose_rmse_dx": 0.2776764929294586,
      "pose_rmse_dy": 0.09973803162574768,
      "pose_rmse_mean": 0.2806802988052368,
      "rmse_dtheta": 0.05747390538454056,
      "rmse_dx": 0.030908474698662758,
      "rmse_dy": 0.007858134806156158,
      "rmse_mean": 0.03208017349243164,
      "rotation_flip": 0.009523809887468815,
      "sparse_tokens": 5740.0,
      "step": 7044,
      "turn_loss": 0.2788699269294739,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.32730905036238617,
      "grad_norm": 0.6237140893936157,
      "learning_rate": 3.7135693938495433e-06,
      "loss": 0.2045,
      "mae_dtheta": 0.029123803600668907,
      "mae_dx": 0.012248669750988483,
      "mae_dy": 0.007026803679764271,
      "pose_mae_dtheta": 0.2291649580001831,
      "pose_mae_dx": 0.09533093124628067,
      "pose_mae_dy": 0.11530406773090363,
      "pose_rmse_dtheta": 0.4018385708332062,
      "pose_rmse_dx": 0.24121452867984772,
      "pose_rmse_dy": 0.23610268533229828,
      "pose_rmse_mean": 0.29305195808410645,
      "rmse_dtheta": 0.045024558901786804,
      "rmse_dx": 0.02710600383579731,
      "rmse_dy": 0.013384760357439518,
      "rmse_mean": 0.028505107387900352,
      "rotation_flip": 0.015118790790438652,
      "sparse_tokens": 9912.0,
      "step": 7045,
      "turn_loss": 0.2473638355731964,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.32735551012822894,
      "grad_norm": 0.5342976450920105,
      "learning_rate": 3.71229173186607e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.005826196633279324,
      "mae_dx": 0.0010181269608438015,
      "mae_dy": 0.000669945206027478,
      "pose_mae_dtheta": 0.0434366799890995,
      "pose_mae_dx": 0.00960733462125063,
      "pose_mae_dy": 0.009876810945570469,
      "pose_rmse_dtheta": 0.18134263157844543,
      "pose_rmse_dx": 0.029844438657164574,
      "pose_rmse_dy": 0.03083358332514763,
      "pose_rmse_mean": 0.08067355304956436,
      "rmse_dtheta": 0.0214388407766819,
      "rmse_dx": 0.0037521396297961473,
      "rmse_dy": 0.0018597766757011414,
      "rmse_mean": 0.009016919881105423,
      "rotation_flip": 0.0012113869888707995,
      "sparse_tokens": 32105.0,
      "step": 7046,
      "turn_loss": 0.03531218320131302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29434.0,
      "epoch": 0.3274019698940717,
      "grad_norm": 0.848298966884613,
      "learning_rate": 3.7110141599327297e-06,
      "loss": 0.2545,
      "mae_dtheta": 0.04448339343070984,
      "mae_dx": 0.012731678783893585,
      "mae_dy": 0.006207245867699385,
      "pose_mae_dtheta": 0.3602812886238098,
      "pose_mae_dx": 0.1060555949807167,
      "pose_mae_dy": 0.07365172356367111,
      "pose_rmse_dtheta": 0.617755651473999,
      "pose_rmse_dx": 0.22262531518936157,
      "pose_rmse_dy": 0.17851801216602325,
      "pose_rmse_mean": 0.3396329879760742,
      "rmse_dtheta": 0.06445640325546265,
      "rmse_dx": 0.024796469137072563,
      "rmse_dy": 0.012749964371323586,
      "rmse_mean": 0.0340009480714798,
      "rotation_flip": 0.017069701105356216,
      "sparse_tokens": 25753.0,
      "step": 7047,
      "turn_loss": 0.31315600872039795,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3274484296599145,
      "grad_norm": 0.4271238446235657,
      "learning_rate": 3.709736678138859e-06,
      "loss": 0.0898,
      "mae_dtheta": 0.013234616257250309,
      "mae_dx": 0.0031029479578137398,
      "mae_dy": 0.004652242176234722,
      "pose_mae_dtheta": 0.0950513705611229,
      "pose_mae_dx": 0.03529369458556175,
      "pose_mae_dy": 0.04116920381784439,
      "pose_rmse_dtheta": 0.22598232328891754,
      "pose_rmse_dx": 0.08890329301357269,
      "pose_rmse_dy": 0.10036063194274902,
      "pose_rmse_mean": 0.13841542601585388,
      "rmse_dtheta": 0.027447637170553207,
      "rmse_dx": 0.007688717916607857,
      "rmse_dy": 0.009703090414404869,
      "rmse_mean": 0.014946483075618744,
      "rotation_flip": 0.007285275962203741,
      "sparse_tokens": 32105.0,
      "step": 7048,
      "turn_loss": 0.1349564790725708,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3274948894257573,
      "grad_norm": 0.5038421750068665,
      "learning_rate": 3.7084592865737946e-06,
      "loss": 0.095,
      "mae_dtheta": 0.012670050375163555,
      "mae_dx": 0.0017173864180222154,
      "mae_dy": 0.002432506065815687,
      "pose_mae_dtheta": 0.08951535820960999,
      "pose_mae_dx": 0.024481050670146942,
      "pose_mae_dy": 0.028980327770113945,
      "pose_rmse_dtheta": 0.2402779757976532,
      "pose_rmse_dx": 0.06293198466300964,
      "pose_rmse_dy": 0.06631886214017868,
      "pose_rmse_mean": 0.12317627668380737,
      "rmse_dtheta": 0.02865493670105934,
      "rmse_dx": 0.004905028734356165,
      "rmse_dy": 0.005457836203277111,
      "rmse_mean": 0.013005934655666351,
      "rotation_flip": 0.007107952143996954,
      "sparse_tokens": 32089.0,
      "step": 7049,
      "turn_loss": 0.09071498364210129,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25959.0,
      "epoch": 0.32754134919160005,
      "grad_norm": 0.5117786526679993,
      "learning_rate": 3.7071819853268675e-06,
      "loss": 0.1104,
      "mae_dtheta": 0.027352603152394295,
      "mae_dx": 0.010229332372546196,
      "mae_dy": 0.0038019565399736166,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5117786526679993,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.38877868652344,
      "model/head/act_norm_mean": 114.51962890625,
      "model/head/act_norm_min": 67.90176391601562,
      "model/head/act_over_embed": 78.69896113403281,
      "model/head/grad_frac": 0.09254132956266403,
      "model/head/grad_norm": 0.047360677272081375,
      "model/head/grad_zero_frac": 0.0001856039889389649,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6816162109375,
      "model/head/update_ratio": 0.0008077243110165,
      "model/head/weight_delta": 9.405095100402832,
      "model/head/weight_delta_rel": 0.16499322652816772,
      "model/head/weight_norm": 58.63470458984375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4217767119407654,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42169608598873937,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42164021730422974,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2897934982724202,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09222138673067093,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04719693586230278,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5180844907407407,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015245575923472643,
      "model/modality_embedder.encoders.pose/weight_delta": 3.026059150695801,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09887078404426575,
      "model/modality_embedder.encoders.pose/weight_norm": 30.95779037475586,
      "model/modality_embedder/grad_frac": 0.09222138673067093,
      "model/modality_embedder/grad_norm": 0.04719693586230278,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5180844907407407,
      "model/modality_embedder/update_ratio": 0.0015245575923472643,
      "model/modality_embedder/weight_delta": 3.026059150695801,
      "model/modality_embedder/weight_delta_rel": 0.09887078404426575,
      "model/modality_embedder/weight_norm": 30.95779037475586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.53411102294922,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.07245628720238,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.311152458190918,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.542817330452,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07172123342752457,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03670539706945419,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013155214255675673,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.468064069747925,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.08993774652481079,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.90178680419922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.92280578613281,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.92395213293651,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.725844383239746,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.127973247470198,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06708933413028717,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03433489054441452,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011571520008146763,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1292450428009033,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10839949548244476,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.671892166137695,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.60315704345703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.594816468253967,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.015633583068848,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.276206861578718,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07113893330097198,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.036407388746738434,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011883587576448917,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.3776040077209473,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11341361701488495,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.63669776916504,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.26851654052734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.398865327380953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.089288711547852,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.515966127342306,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07725408673286438,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03953699395060539,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001323386444710195,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.890878915786743,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09879652410745621,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.875621795654297,
      "model/normalizer/grad_frac": 0.275433748960495,
      "model/normalizer/grad_norm": 0.14096111059188843,
      "model/normalizer/grad_zero_frac": 0.0002115311799570918,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001794590731151402,
      "model/normalizer/weight_delta": 6.109846115112305,
      "model/normalizer/weight_delta_rel": 0.0786912813782692,
      "model/normalizer/weight_norm": 78.54777526855469,
      "pose_mae_dtheta": 0.1974172741174698,
      "pose_mae_dx": 0.07949522137641907,
      "pose_mae_dy": 0.04613122716546059,
      "pose_rmse_dtheta": 0.3610057830810547,
      "pose_rmse_dx": 0.20829549431800842,
      "pose_rmse_dy": 0.12287696450948715,
      "pose_rmse_mean": 0.23072606325149536,
      "rmse_dtheta": 0.04490241780877113,
      "rmse_dx": 0.023362236097455025,
      "rmse_dy": 0.0073768338188529015,
      "rmse_mean": 0.025213830173015594,
      "rotation_flip": 0.008818342350423336,
      "sparse_tokens": 19573.0,
      "step": 7050,
      "turn_loss": 0.23162779211997986,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.3275878089574428,
      "grad_norm": 0.535508930683136,
      "learning_rate": 3.705904774487396e-06,
      "loss": 0.1582,
      "mae_dtheta": 0.036282796412706375,
      "mae_dx": 0.010127123445272446,
      "mae_dy": 0.003560796147212386,
      "pose_mae_dtheta": 0.2636934816837311,
      "pose_mae_dx": 0.08000782132148743,
      "pose_mae_dy": 0.037359029054641724,
      "pose_rmse_dtheta": 0.4853758215904236,
      "pose_rmse_dx": 0.18922877311706543,
      "pose_rmse_dy": 0.08799814432859421,
      "pose_rmse_mean": 0.25420093536376953,
      "rmse_dtheta": 0.055806927382946014,
      "rmse_dx": 0.021667281165719032,
      "rmse_dy": 0.007824648171663284,
      "rmse_mean": 0.028432950377464294,
      "rotation_flip": 0.011503697372972965,
      "sparse_tokens": 19489.0,
      "step": 7051,
      "turn_loss": 0.26434648036956787,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.32763426872328566,
      "grad_norm": 0.4248901605606079,
      "learning_rate": 3.7046276541447006e-06,
      "loss": 0.0947,
      "mae_dtheta": 0.04621950164437294,
      "mae_dx": 0.013187437318265438,
      "mae_dy": 0.004393155220896006,
      "pose_mae_dtheta": 0.37096214294433594,
      "pose_mae_dx": 0.10486198961734772,
      "pose_mae_dy": 0.056715596467256546,
      "pose_rmse_dtheta": 0.6031267046928406,
      "pose_rmse_dx": 0.21437707543373108,
      "pose_rmse_dy": 0.12450865656137466,
      "pose_rmse_mean": 0.31400418281555176,
      "rmse_dtheta": 0.06351778656244278,
      "rmse_dx": 0.02469865046441555,
      "rmse_dy": 0.00943288765847683,
      "rmse_mean": 0.03254977613687515,
      "rotation_flip": 0.01937984488904476,
      "sparse_tokens": 8299.0,
      "step": 7052,
      "turn_loss": 0.3348371386528015,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.32768072848912844,
      "grad_norm": 0.5003294348716736,
      "learning_rate": 3.703350624388087e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.012875917367637157,
      "mae_dx": 0.0023388138506561518,
      "mae_dy": 0.0029446410480886698,
      "pose_mae_dtheta": 0.08233677595853806,
      "pose_mae_dx": 0.02816792018711567,
      "pose_mae_dy": 0.031873367726802826,
      "pose_rmse_dtheta": 0.20670469105243683,
      "pose_rmse_dx": 0.06751176714897156,
      "pose_rmse_dy": 0.06904488056898117,
      "pose_rmse_mean": 0.11442045867443085,
      "rmse_dtheta": 0.028953667730093002,
      "rmse_dx": 0.006860446650534868,
      "rmse_dy": 0.006295067723840475,
      "rmse_mean": 0.014036393724381924,
      "rotation_flip": 0.005025125574320555,
      "sparse_tokens": 32105.0,
      "step": 7053,
      "turn_loss": 0.15069161355495453,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3277271882549712,
      "grad_norm": 0.5789729952812195,
      "learning_rate": 3.7020736853068612e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.007076800335198641,
      "mae_dx": 0.0010204582940787077,
      "mae_dy": 0.0014199487632140517,
      "pose_mae_dtheta": 0.056854184716939926,
      "pose_mae_dx": 0.014027578756213188,
      "pose_mae_dy": 0.021406343206763268,
      "pose_rmse_dtheta": 0.15830036997795105,
      "pose_rmse_dx": 0.04171805456280708,
      "pose_rmse_dy": 0.059426963329315186,
      "pose_rmse_mean": 0.08648179471492767,
      "rmse_dtheta": 0.01753063127398491,
      "rmse_dx": 0.0030911259818822145,
      "rmse_dy": 0.0035778782330453396,
      "rmse_mean": 0.00806654617190361,
      "rotation_flip": 0.003208066103979945,
      "sparse_tokens": 32089.0,
      "step": 7054,
      "turn_loss": 0.05354638025164604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.327773648020814,
      "grad_norm": 0.62540602684021,
      "learning_rate": 3.7007968369903176e-06,
      "loss": 0.2398,
      "mae_dtheta": 0.023316554725170135,
      "mae_dx": 0.01185999158769846,
      "mae_dy": 0.004593252670019865,
      "pose_mae_dtheta": 0.20412789285182953,
      "pose_mae_dx": 0.08844774216413498,
      "pose_mae_dy": 0.0563899502158165,
      "pose_rmse_dtheta": 0.35760465264320374,
      "pose_rmse_dx": 0.17884866893291473,
      "pose_rmse_dy": 0.1414870023727417,
      "pose_rmse_mean": 0.22598010301589966,
      "rmse_dtheta": 0.03714120015501976,
      "rmse_dx": 0.023964809253811836,
      "rmse_dy": 0.008954275399446487,
      "rmse_mean": 0.02335342764854431,
      "rotation_flip": 0.02787456475198269,
      "sparse_tokens": 5293.0,
      "step": 7055,
      "turn_loss": 0.16412238776683807,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.32782010778665677,
      "grad_norm": 0.44175028800964355,
      "learning_rate": 3.6995200795277485e-06,
      "loss": 0.0972,
      "mae_dtheta": 0.033180512487888336,
      "mae_dx": 0.014487412758171558,
      "mae_dy": 0.007869713939726353,
      "pose_mae_dtheta": 0.24738061428070068,
      "pose_mae_dx": 0.14017616212368011,
      "pose_mae_dy": 0.06569117307662964,
      "pose_rmse_dtheta": 0.4174196124076843,
      "pose_rmse_dx": 0.29080089926719666,
      "pose_rmse_dy": 0.1489020437002182,
      "pose_rmse_mean": 0.2857075333595276,
      "rmse_dtheta": 0.048970893025398254,
      "rmse_dx": 0.027354862540960312,
      "rmse_dy": 0.01734813302755356,
      "rmse_mean": 0.031224630773067474,
      "rotation_flip": 0.010395010001957417,
      "sparse_tokens": 8903.0,
      "step": 7056,
      "turn_loss": 0.39614418148994446,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.32786656755249954,
      "grad_norm": 0.5759040117263794,
      "learning_rate": 3.69824341300844e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.024522386491298676,
      "mae_dx": 0.010564821772277355,
      "mae_dy": 0.0047841863706707954,
      "pose_mae_dtheta": 0.1829533576965332,
      "pose_mae_dx": 0.07686395198106766,
      "pose_mae_dy": 0.04510986804962158,
      "pose_rmse_dtheta": 0.3184548616409302,
      "pose_rmse_dx": 0.19597375392913818,
      "pose_rmse_dy": 0.10394315421581268,
      "pose_rmse_mean": 0.2061239331960678,
      "rmse_dtheta": 0.03869510069489479,
      "rmse_dx": 0.023004604503512383,
      "rmse_dy": 0.009255469776690006,
      "rmse_mean": 0.0236517246812582,
      "rotation_flip": 0.010660980828106403,
      "sparse_tokens": 8334.0,
      "step": 7057,
      "turn_loss": 0.20392563939094543,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3279130273183423,
      "grad_norm": 0.4300747215747833,
      "learning_rate": 3.696966837521667e-06,
      "loss": 0.0906,
      "mae_dtheta": 0.0063101439736783504,
      "mae_dx": 0.00076013442594558,
      "mae_dy": 0.0008665649220347404,
      "pose_mae_dtheta": 0.04818102717399597,
      "pose_mae_dx": 0.007814191281795502,
      "pose_mae_dy": 0.01538683008402586,
      "pose_rmse_dtheta": 0.17681707441806793,
      "pose_rmse_dx": 0.02005661465227604,
      "pose_rmse_dy": 0.04297690466046333,
      "pose_rmse_mean": 0.07995019853115082,
      "rmse_dtheta": 0.01998787932097912,
      "rmse_dx": 0.002495502820238471,
      "rmse_dy": 0.002556578256189823,
      "rmse_mean": 0.008346653543412685,
      "rotation_flip": 0.0012307692086324096,
      "sparse_tokens": 32073.0,
      "step": 7058,
      "turn_loss": 0.038763273507356644,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.3279594870841851,
      "grad_norm": 0.8527929186820984,
      "learning_rate": 3.695690353156704e-06,
      "loss": 0.2398,
      "mae_dtheta": 0.03534916043281555,
      "mae_dx": 0.009945005178451538,
      "mae_dy": 0.00532169733196497,
      "pose_mae_dtheta": 0.26329776644706726,
      "pose_mae_dx": 0.08662905544042587,
      "pose_mae_dy": 0.062138233333826065,
      "pose_rmse_dtheta": 0.5024762153625488,
      "pose_rmse_dx": 0.212937593460083,
      "pose_rmse_dy": 0.1207050085067749,
      "pose_rmse_mean": 0.27870628237724304,
      "rmse_dtheta": 0.05530558153986931,
      "rmse_dx": 0.02249225229024887,
      "rmse_dy": 0.009775988757610321,
      "rmse_mean": 0.0291912741959095,
      "rotation_flip": 0.01112656481564045,
      "sparse_tokens": 13573.0,
      "step": 7059,
      "turn_loss": 0.2824482321739197,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3280059468500279,
      "grad_norm": 0.5159462094306946,
      "learning_rate": 3.694413960002814e-06,
      "loss": 0.0855,
      "mae_dtheta": 0.012533504515886307,
      "mae_dx": 0.0020551858469843864,
      "mae_dy": 0.0026405220851302147,
      "pose_mae_dtheta": 0.08466504514217377,
      "pose_mae_dx": 0.023095279932022095,
      "pose_mae_dy": 0.024374954402446747,
      "pose_rmse_dtheta": 0.22876566648483276,
      "pose_rmse_dx": 0.07204950600862503,
      "pose_rmse_dy": 0.0536336712539196,
      "pose_rmse_mean": 0.11814960837364197,
      "rmse_dtheta": 0.027893589809536934,
      "rmse_dx": 0.005877048242837191,
      "rmse_dy": 0.006641245912760496,
      "rmse_mean": 0.01347062923014164,
      "rotation_flip": 0.006954102776944637,
      "sparse_tokens": 32169.0,
      "step": 7060,
      "turn_loss": 0.10767794400453568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.32805240661587065,
      "grad_norm": 0.40152454376220703,
      "learning_rate": 3.6931376581492564e-06,
      "loss": 0.112,
      "mae_dtheta": 0.01249042246490717,
      "mae_dx": 0.0029686070047318935,
      "mae_dy": 0.004478351678699255,
      "pose_mae_dtheta": 0.09195001423358917,
      "pose_mae_dx": 0.03874657675623894,
      "pose_mae_dy": 0.03344782441854477,
      "pose_rmse_dtheta": 0.21306416392326355,
      "pose_rmse_dx": 0.10201118141412735,
      "pose_rmse_dy": 0.06824523210525513,
      "pose_rmse_mean": 0.12777352333068848,
      "rmse_dtheta": 0.02596190758049488,
      "rmse_dx": 0.008037135936319828,
      "rmse_dy": 0.009436790831387043,
      "rmse_mean": 0.014478611759841442,
      "rotation_flip": 0.007384615484625101,
      "sparse_tokens": 32137.0,
      "step": 7061,
      "turn_loss": 0.11378336697816849,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.3280988663817134,
      "grad_norm": 0.5712745189666748,
      "learning_rate": 3.6918614476852833e-06,
      "loss": 0.1823,
      "mae_dtheta": 0.025593170896172523,
      "mae_dx": 0.010273166000843048,
      "mae_dy": 0.005629096180200577,
      "pose_mae_dtheta": 0.1938043236732483,
      "pose_mae_dx": 0.07758914679288864,
      "pose_mae_dy": 0.0788612961769104,
      "pose_rmse_dtheta": 0.34855347871780396,
      "pose_rmse_dx": 0.1716674566268921,
      "pose_rmse_dy": 0.17688342928886414,
      "pose_rmse_mean": 0.2323681116104126,
      "rmse_dtheta": 0.04007929936051369,
      "rmse_dx": 0.02268945798277855,
      "rmse_dy": 0.010376719757914543,
      "rmse_mean": 0.02438182756304741,
      "rotation_flip": 0.007431874517351389,
      "sparse_tokens": 19691.0,
      "step": 7062,
      "turn_loss": 0.22792544960975647,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.3281453261475562,
      "grad_norm": 0.557800829410553,
      "learning_rate": 3.6905853287001405e-06,
      "loss": 0.1386,
      "mae_dtheta": 0.023611072450876236,
      "mae_dx": 0.008321849629282951,
      "mae_dy": 0.005145339295268059,
      "pose_mae_dtheta": 0.18660025298595428,
      "pose_mae_dx": 0.07788879424333572,
      "pose_mae_dy": 0.0786220133304596,
      "pose_rmse_dtheta": 0.35809287428855896,
      "pose_rmse_dx": 0.20043452084064484,
      "pose_rmse_dy": 0.15708500146865845,
      "pose_rmse_mean": 0.2385374754667282,
      "rmse_dtheta": 0.03817788138985634,
      "rmse_dx": 0.020896656438708305,
      "rmse_dy": 0.008903912268579006,
      "rmse_mean": 0.022659484297037125,
      "rotation_flip": 0.002728512976318598,
      "sparse_tokens": 15682.0,
      "step": 7063,
      "turn_loss": 0.22725576162338257,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.328191785913399,
      "grad_norm": 0.723595917224884,
      "learning_rate": 3.6893093012830705e-06,
      "loss": 0.1716,
      "mae_dtheta": 0.040581025183200836,
      "mae_dx": 0.014260854572057724,
      "mae_dy": 0.007125464733690023,
      "pose_mae_dtheta": 0.32845327258110046,
      "pose_mae_dx": 0.10774598270654678,
      "pose_mae_dy": 0.0953066349029541,
      "pose_rmse_dtheta": 0.5608118772506714,
      "pose_rmse_dx": 0.21824978291988373,
      "pose_rmse_dy": 0.24135668575763702,
      "pose_rmse_mean": 0.3401394784450531,
      "rmse_dtheta": 0.05988346040248871,
      "rmse_dx": 0.026651715859770775,
      "rmse_dy": 0.01624653860926628,
      "rmse_mean": 0.034260571002960205,
      "rotation_flip": 0.0390625,
      "sparse_tokens": 4435.0,
      "step": 7064,
      "turn_loss": 0.2710351347923279,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 15220.0,
      "epoch": 0.32823824567924176,
      "grad_norm": 0.6125933527946472,
      "learning_rate": 3.688033365523303e-06,
      "loss": 0.1885,
      "mae_dtheta": 0.04027552902698517,
      "mae_dx": 0.013788345269858837,
      "mae_dy": 0.004507133737206459,
      "pose_mae_dtheta": 0.32422199845314026,
      "pose_mae_dx": 0.09938187152147293,
      "pose_mae_dy": 0.047973547130823135,
      "pose_rmse_dtheta": 0.5243266224861145,
      "pose_rmse_dx": 0.19731460511684418,
      "pose_rmse_dy": 0.12205906957387924,
      "pose_rmse_mean": 0.28123342990875244,
      "rmse_dtheta": 0.05769887566566467,
      "rmse_dx": 0.0253599900752306,
      "rmse_dy": 0.008408746682107449,
      "rmse_mean": 0.030489204451441765,
      "rotation_flip": 0.011904762126505375,
      "sparse_tokens": 11567.0,
      "step": 7065,
      "turn_loss": 0.23226287961006165,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.32828470544508453,
      "grad_norm": 0.5351145267486572,
      "learning_rate": 3.686757521510068e-06,
      "loss": 0.0625,
      "mae_dtheta": 0.006322304252535105,
      "mae_dx": 0.0009706153650768101,
      "mae_dy": 0.0010816260473802686,
      "pose_mae_dtheta": 0.046395666897296906,
      "pose_mae_dx": 0.010630641132593155,
      "pose_mae_dy": 0.014947722665965557,
      "pose_rmse_dtheta": 0.1673159897327423,
      "pose_rmse_dx": 0.034883227199316025,
      "pose_rmse_dy": 0.041730206459760666,
      "pose_rmse_mean": 0.08130981028079987,
      "rmse_dtheta": 0.019529715180397034,
      "rmse_dx": 0.003628389909863472,
      "rmse_dy": 0.0031128174159675837,
      "rmse_mean": 0.008756974712014198,
      "rotation_flip": 0.002518891589716077,
      "sparse_tokens": 32057.0,
      "step": 7066,
      "turn_loss": 0.04252731427550316,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3283311652109273,
      "grad_norm": 0.5664116144180298,
      "learning_rate": 3.6854817693325828e-06,
      "loss": 0.105,
      "mae_dtheta": 0.008113889954984188,
      "mae_dx": 0.0010840448085218668,
      "mae_dy": 0.0014521607663482428,
      "pose_mae_dtheta": 0.05429499223828316,
      "pose_mae_dx": 0.012567706406116486,
      "pose_mae_dy": 0.019128991290926933,
      "pose_rmse_dtheta": 0.1570630669593811,
      "pose_rmse_dx": 0.0355202853679657,
      "pose_rmse_dy": 0.04360480606555939,
      "pose_rmse_mean": 0.07872939109802246,
      "rmse_dtheta": 0.019086036831140518,
      "rmse_dx": 0.003937558736652136,
      "rmse_dy": 0.00305387401022017,
      "rmse_mean": 0.008692489936947823,
      "rotation_flip": 0.0033003301359713078,
      "sparse_tokens": 32073.0,
      "step": 7067,
      "turn_loss": 0.05392605438828468,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.32837762497677014,
      "grad_norm": 0.41737908124923706,
      "learning_rate": 3.6842061090800622e-06,
      "loss": 0.0983,
      "mae_dtheta": 0.006591851357370615,
      "mae_dx": 0.0010191017063334584,
      "mae_dy": 0.0010118810459971428,
      "pose_mae_dtheta": 0.049467261880636215,
      "pose_mae_dx": 0.010551939718425274,
      "pose_mae_dy": 0.012853746302425861,
      "pose_rmse_dtheta": 0.20332328975200653,
      "pose_rmse_dx": 0.025414438918232918,
      "pose_rmse_dy": 0.03460809588432312,
      "pose_rmse_mean": 0.08778195083141327,
      "rmse_dtheta": 0.02177337184548378,
      "rmse_dx": 0.002890635747462511,
      "rmse_dy": 0.0028007798828184605,
      "rmse_mean": 0.009154928848147392,
      "rotation_flip": 0.0013398838927969337,
      "sparse_tokens": 32169.0,
      "step": 7068,
      "turn_loss": 0.04142213612794876,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.3284240847426129,
      "grad_norm": 0.4637134373188019,
      "learning_rate": 3.682930540841717e-06,
      "loss": 0.1191,
      "mae_dtheta": 0.03774583339691162,
      "mae_dx": 0.015857981517910957,
      "mae_dy": 0.0038263066671788692,
      "pose_mae_dtheta": 0.33737167716026306,
      "pose_mae_dx": 0.13685017824172974,
      "pose_mae_dy": 0.03671812638640404,
      "pose_rmse_dtheta": 0.6317160725593567,
      "pose_rmse_dx": 0.2881503105163574,
      "pose_rmse_dy": 0.09157080948352814,
      "pose_rmse_mean": 0.33714574575424194,
      "rmse_dtheta": 0.05883074924349785,
      "rmse_dx": 0.02985534630715847,
      "rmse_dy": 0.0070268926210701466,
      "rmse_mean": 0.03190433233976364,
      "rotation_flip": 0.004807692486792803,
      "sparse_tokens": 8087.0,
      "step": 7069,
      "turn_loss": 0.2665475010871887,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3284705445084557,
      "grad_norm": 0.4373379349708557,
      "learning_rate": 3.6816550647067447e-06,
      "loss": 0.1353,
      "mae_dtheta": 0.010173961520195007,
      "mae_dx": 0.002482013311237097,
      "mae_dy": 0.002623502165079117,
      "pose_mae_dtheta": 0.0654289647936821,
      "pose_mae_dx": 0.025522379204630852,
      "pose_mae_dy": 0.03372637555003166,
      "pose_rmse_dtheta": 0.1296476125717163,
      "pose_rmse_dx": 0.058243464678525925,
      "pose_rmse_dy": 0.07644432783126831,
      "pose_rmse_mean": 0.08811180293560028,
      "rmse_dtheta": 0.0206877663731575,
      "rmse_dx": 0.007420167792588472,
      "rmse_dy": 0.00592143414542079,
      "rmse_mean": 0.011343123391270638,
      "rotation_flip": 0.004313443787395954,
      "sparse_tokens": 32089.0,
      "step": 7070,
      "turn_loss": 0.11416047066450119,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.3285170042742985,
      "grad_norm": 0.9856616854667664,
      "learning_rate": 3.6803796807643426e-06,
      "loss": 0.2644,
      "mae_dtheta": 0.03375089913606644,
      "mae_dx": 0.01596371829509735,
      "mae_dy": 0.0031347479671239853,
      "pose_mae_dtheta": 0.29364821314811707,
      "pose_mae_dx": 0.1328672170639038,
      "pose_mae_dy": 0.03764406219124794,
      "pose_rmse_dtheta": 0.5072486400604248,
      "pose_rmse_dx": 0.27795690298080444,
      "pose_rmse_dy": 0.09308719635009766,
      "pose_rmse_mean": 0.29276424646377563,
      "rmse_dtheta": 0.05265325307846069,
      "rmse_dx": 0.029680928215384483,
      "rmse_dy": 0.006386245135217905,
      "rmse_mean": 0.029573475942015648,
      "rotation_flip": 0.016506189480423927,
      "sparse_tokens": 12821.0,
      "step": 7071,
      "turn_loss": 0.27534690499305725,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.32856346404014125,
      "grad_norm": 0.42039990425109863,
      "learning_rate": 3.679104389103696e-06,
      "loss": 0.0892,
      "mae_dtheta": 0.02273573912680149,
      "mae_dx": 0.010279107838869095,
      "mae_dy": 0.0028575167525559664,
      "pose_mae_dtheta": 0.1380310207605362,
      "pose_mae_dx": 0.07822810113430023,
      "pose_mae_dy": 0.03591408580541611,
      "pose_rmse_dtheta": 0.2739418148994446,
      "pose_rmse_dx": 0.19170443713665009,
      "pose_rmse_dy": 0.09247715771198273,
      "pose_rmse_mean": 0.18604114651679993,
      "rmse_dtheta": 0.04010704159736633,
      "rmse_dx": 0.022709576413035393,
      "rmse_dy": 0.006911441218107939,
      "rmse_mean": 0.023242687806487083,
      "rotation_flip": 0.012658228166401386,
      "sparse_tokens": 8797.0,
      "step": 7072,
      "turn_loss": 0.17990995943546295,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.328609923805984,
      "grad_norm": 0.297389954328537,
      "learning_rate": 3.6778291898139907e-06,
      "loss": 0.0675,
      "mae_dtheta": 0.010950875468552113,
      "mae_dx": 0.001523086684755981,
      "mae_dy": 0.002705374965444207,
      "pose_mae_dtheta": 0.06914715468883514,
      "pose_mae_dx": 0.02255937270820141,
      "pose_mae_dy": 0.0300288163125515,
      "pose_rmse_dtheta": 0.1648019552230835,
      "pose_rmse_dx": 0.06096871942281723,
      "pose_rmse_dy": 0.06346803903579712,
      "pose_rmse_mean": 0.09641291201114655,
      "rmse_dtheta": 0.021404322236776352,
      "rmse_dx": 0.00477189477533102,
      "rmse_dy": 0.0059349387884140015,
      "rmse_mean": 0.010703719221055508,
      "rotation_flip": 0.008424908854067326,
      "sparse_tokens": 32057.0,
      "step": 7073,
      "turn_loss": 0.09144388139247894,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3286563835718268,
      "grad_norm": 0.47471219301223755,
      "learning_rate": 3.676554082984397e-06,
      "loss": 0.1317,
      "mae_dtheta": 0.006928388029336929,
      "mae_dx": 0.0011633825488388538,
      "mae_dy": 0.0005136368563398719,
      "pose_mae_dtheta": 0.053317394107580185,
      "pose_mae_dx": 0.010034331120550632,
      "pose_mae_dy": 0.008020498789846897,
      "pose_rmse_dtheta": 0.2331303060054779,
      "pose_rmse_dx": 0.029554517939686775,
      "pose_rmse_dy": 0.023663096129894257,
      "pose_rmse_mean": 0.09544931352138519,
      "rmse_dtheta": 0.025980964303016663,
      "rmse_dx": 0.004103048704564571,
      "rmse_dy": 0.0013919109478592873,
      "rmse_mean": 0.010491974651813507,
      "rotation_flip": 0.0007886435487307608,
      "sparse_tokens": 32105.0,
      "step": 7074,
      "turn_loss": 0.042458079755306244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3287028433376696,
      "grad_norm": 0.4595300555229187,
      "learning_rate": 3.675279068704087e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.011791791766881943,
      "mae_dx": 0.0018791337497532368,
      "mae_dy": 0.00308631150983274,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4595298767089844,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 163.5341796875,
      "model/head/act_norm_mean": 107.17554450757575,
      "model/head/act_norm_min": 59.062740325927734,
      "model/head/act_over_embed": 73.65203757886245,
      "model/head/grad_frac": 0.09458635002374649,
      "model/head/grad_norm": 0.043465252965688705,
      "model/head/grad_zero_frac": 0.00020019848307128996,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7077858664772727,
      "model/head/update_ratio": 0.0007412667036987841,
      "model/head/weight_delta": 9.414445877075195,
      "model/head/weight_delta_rel": 0.1651572734117508,
      "model/head/weight_norm": 58.63645553588867,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42177364230155945,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4217073642713134,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4216475784778595,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.289801248813794,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07846423238515854,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03605666011571884,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.541150633640553,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011646987404674292,
      "model/modality_embedder.encoders.pose/weight_delta": 3.026782274246216,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09889440983533859,
      "model/modality_embedder.encoders.pose/weight_norm": 30.957929611206055,
      "model/modality_embedder/grad_frac": 0.07846423238515854,
      "model/modality_embedder/grad_norm": 0.03605666011571884,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.541150633640553,
      "model/modality_embedder/update_ratio": 0.0011646987404674292,
      "model/modality_embedder/weight_delta": 3.026782274246216,
      "model/modality_embedder/weight_delta_rel": 0.09889440983533859,
      "model/modality_embedder/weight_norm": 30.957929611206055,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.33277893066406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.3288465007215,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.01867389678955,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.03180172339783,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06380574405193329,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.029320646077394485,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010508308187127113,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4717018604278564,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09007030725479126,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.902347564697266,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.8732681274414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.28035563973064,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.264078140258789,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.68568771189382,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06484600901603699,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.029798679053783417,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001004224643111229,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1343843936920166,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10857752710580826,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.673320770263672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.82085418701172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.1003537357704,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.545759201049805,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.936407442582976,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06599094718694687,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030324812978506088,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009897678392007947,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.3832249641418457,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11360236257314682,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.638307571411133,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.98273468017578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.895156926406926,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.411802291870117,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.169812998400605,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07442133128643036,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0341988243162632,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011446677381172776,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.895193338394165,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09894397109746933,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.876638412475586,
      "model/normalizer/grad_frac": 0.2569049596786499,
      "model/normalizer/grad_norm": 0.11805550009012222,
      "model/normalizer/grad_zero_frac": 0.0002458015806041658,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001502946950495243,
      "model/normalizer/weight_delta": 6.119518280029297,
      "model/normalizer/weight_delta_rel": 0.07881585508584976,
      "model/normalizer/weight_norm": 78.54934692382812,
      "pose_mae_dtheta": 0.07841134816408157,
      "pose_mae_dx": 0.02600553259253502,
      "pose_mae_dy": 0.03488508239388466,
      "pose_rmse_dtheta": 0.16949237883090973,
      "pose_rmse_dx": 0.07280021160840988,
      "pose_rmse_dy": 0.08734161406755447,
      "pose_rmse_mean": 0.1098780632019043,
      "rmse_dtheta": 0.022451048716902733,
      "rmse_dx": 0.0058808838948607445,
      "rmse_dy": 0.006934614386409521,
      "rmse_mean": 0.01175551488995552,
      "rotation_flip": 0.004291845485568047,
      "sparse_tokens": 32057.0,
      "step": 7075,
      "turn_loss": 0.10788022726774216,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.32874930310351236,
      "grad_norm": 0.5926961898803711,
      "learning_rate": 3.6740041470622245e-06,
      "loss": 0.1067,
      "mae_dtheta": 0.036196280270814896,
      "mae_dx": 0.012354528531432152,
      "mae_dy": 0.0028867076616734266,
      "pose_mae_dtheta": 0.29644158482551575,
      "pose_mae_dx": 0.09582880139350891,
      "pose_mae_dy": 0.03401327505707741,
      "pose_rmse_dtheta": 0.5143255591392517,
      "pose_rmse_dx": 0.22467289865016937,
      "pose_rmse_dy": 0.08641324192285538,
      "pose_rmse_mean": 0.2751372456550598,
      "rmse_dtheta": 0.05558116361498833,
      "rmse_dx": 0.025324946269392967,
      "rmse_dy": 0.006618457846343517,
      "rmse_mean": 0.02917485497891903,
      "rotation_flip": 0.009685230441391468,
      "sparse_tokens": 13812.0,
      "step": 7076,
      "turn_loss": 0.20225653052330017,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.32879576286935513,
      "grad_norm": 0.4849603772163391,
      "learning_rate": 3.6727293181479617e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.00900986697524786,
      "mae_dx": 0.001401935936883092,
      "mae_dy": 0.0015486725606024265,
      "pose_mae_dtheta": 0.06236247718334198,
      "pose_mae_dx": 0.01837904565036297,
      "pose_mae_dy": 0.024346882477402687,
      "pose_rmse_dtheta": 0.18093270063400269,
      "pose_rmse_dx": 0.0572471097111702,
      "pose_rmse_dy": 0.06065107136964798,
      "pose_rmse_mean": 0.09961029142141342,
      "rmse_dtheta": 0.021681087091565132,
      "rmse_dx": 0.004961296916007996,
      "rmse_dy": 0.0036896325182169676,
      "rmse_mean": 0.010110672563314438,
      "rotation_flip": 0.003501750761643052,
      "sparse_tokens": 32057.0,
      "step": 7077,
      "turn_loss": 0.060478586703538895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3288422226351979,
      "grad_norm": 0.6190718412399292,
      "learning_rate": 3.671454582050453e-06,
      "loss": 0.1618,
      "mae_dtheta": 0.010679266415536404,
      "mae_dx": 0.001097436179406941,
      "mae_dy": 0.0022019522730261087,
      "pose_mae_dtheta": 0.06617927551269531,
      "pose_mae_dx": 0.015788018703460693,
      "pose_mae_dy": 0.026942158117890358,
      "pose_rmse_dtheta": 0.13073650002479553,
      "pose_rmse_dx": 0.037020161747932434,
      "pose_rmse_dy": 0.05749457702040672,
      "pose_rmse_mean": 0.07508374750614166,
      "rmse_dtheta": 0.01980694569647312,
      "rmse_dx": 0.003136822720989585,
      "rmse_dy": 0.004460332449525595,
      "rmse_mean": 0.009134700521826744,
      "rotation_flip": 0.0044750431552529335,
      "sparse_tokens": 32105.0,
      "step": 7078,
      "turn_loss": 0.08195587992668152,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3288886824010407,
      "grad_norm": 0.29322198033332825,
      "learning_rate": 3.6701799388588367e-06,
      "loss": 0.076,
      "mae_dtheta": 0.010037579573690891,
      "mae_dx": 0.0022846960928291082,
      "mae_dy": 0.0019103428348898888,
      "pose_mae_dtheta": 0.07041183859109879,
      "pose_mae_dx": 0.02538454905152321,
      "pose_mae_dy": 0.021760664880275726,
      "pose_rmse_dtheta": 0.19286897778511047,
      "pose_rmse_dx": 0.0857614055275917,
      "pose_rmse_dy": 0.05977122485637665,
      "pose_rmse_mean": 0.11280053853988647,
      "rmse_dtheta": 0.02369142509996891,
      "rmse_dx": 0.007437507156282663,
      "rmse_dy": 0.004776774439960718,
      "rmse_mean": 0.011968569830060005,
      "rotation_flip": 0.0033112582750618458,
      "sparse_tokens": 32137.0,
      "step": 7079,
      "turn_loss": 0.07899286597967148,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.32893514216688347,
      "grad_norm": 0.48802250623703003,
      "learning_rate": 3.6689053886622512e-06,
      "loss": 0.1056,
      "mae_dtheta": 0.010264679789543152,
      "mae_dx": 0.0017101566772907972,
      "mae_dy": 0.0027695042081177235,
      "pose_mae_dtheta": 0.07184384763240814,
      "pose_mae_dx": 0.025422677397727966,
      "pose_mae_dy": 0.027756253257393837,
      "pose_rmse_dtheta": 0.1586098074913025,
      "pose_rmse_dx": 0.06157757341861725,
      "pose_rmse_dy": 0.05627727881073952,
      "pose_rmse_mean": 0.09215489029884338,
      "rmse_dtheta": 0.02201838791370392,
      "rmse_dx": 0.004835539031773806,
      "rmse_dy": 0.005469379015266895,
      "rmse_mean": 0.010774435475468636,
      "rotation_flip": 0.004978426732122898,
      "sparse_tokens": 32089.0,
      "step": 7080,
      "turn_loss": 0.09389541298151016,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.32898160193272624,
      "grad_norm": 0.3523264527320862,
      "learning_rate": 3.667630931549826e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.03578520566225052,
      "mae_dx": 0.010391240008175373,
      "mae_dy": 0.005823978688567877,
      "pose_mae_dtheta": 0.27051201462745667,
      "pose_mae_dx": 0.07976539433002472,
      "pose_mae_dy": 0.07082846015691757,
      "pose_rmse_dtheta": 0.5019180774688721,
      "pose_rmse_dx": 0.17766639590263367,
      "pose_rmse_dy": 0.14820849895477295,
      "pose_rmse_mean": 0.2759310007095337,
      "rmse_dtheta": 0.05659203976392746,
      "rmse_dx": 0.021685777232050896,
      "rmse_dy": 0.011867037974298,
      "rmse_mean": 0.03004828654229641,
      "rotation_flip": 0.0015360983088612556,
      "sparse_tokens": 12180.0,
      "step": 7081,
      "turn_loss": 0.33480626344680786,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.329028061698569,
      "grad_norm": 1.8437633514404297,
      "learning_rate": 3.666356567610684e-06,
      "loss": 0.3596,
      "mae_dtheta": 0.039662133902311325,
      "mae_dx": 0.018692566081881523,
      "mae_dy": 0.008607093244791031,
      "pose_mae_dtheta": 0.2999872863292694,
      "pose_mae_dx": 0.1402091532945633,
      "pose_mae_dy": 0.12261833995580673,
      "pose_rmse_dtheta": 0.4722253978252411,
      "pose_rmse_dx": 0.2857852280139923,
      "pose_rmse_dy": 0.2823851704597473,
      "pose_rmse_mean": 0.3467985987663269,
      "rmse_dtheta": 0.05484289303421974,
      "rmse_dx": 0.03307673707604408,
      "rmse_dy": 0.016749268397688866,
      "rmse_mean": 0.03488963469862938,
      "rotation_flip": 0.01861042156815529,
      "sparse_tokens": 13839.0,
      "step": 7082,
      "turn_loss": 0.4076129198074341,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.3290745214644118,
      "grad_norm": 0.41350317001342773,
      "learning_rate": 3.6650822969339457e-06,
      "loss": 0.0823,
      "mae_dtheta": 0.02854270115494728,
      "mae_dx": 0.005438813008368015,
      "mae_dy": 0.004372841212898493,
      "pose_mae_dtheta": 0.2175382375717163,
      "pose_mae_dx": 0.039212871342897415,
      "pose_mae_dy": 0.04720786586403847,
      "pose_rmse_dtheta": 0.4789203703403473,
      "pose_rmse_dx": 0.09719855338335037,
      "pose_rmse_dy": 0.1512925922870636,
      "pose_rmse_mean": 0.24247050285339355,
      "rmse_dtheta": 0.05192455276846886,
      "rmse_dx": 0.013452832587063313,
      "rmse_dy": 0.01095071155577898,
      "rmse_mean": 0.0254427008330822,
      "rotation_flip": 0.025830257683992386,
      "sparse_tokens": 10077.0,
      "step": 7083,
      "turn_loss": 0.15903106331825256,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.3291209812302546,
      "grad_norm": 0.6514912843704224,
      "learning_rate": 3.663808119608716e-06,
      "loss": 0.1735,
      "mae_dtheta": 0.033320508897304535,
      "mae_dx": 0.012287585996091366,
      "mae_dy": 0.006141738034784794,
      "pose_mae_dtheta": 0.25091952085494995,
      "pose_mae_dx": 0.10607576370239258,
      "pose_mae_dy": 0.08119099587202072,
      "pose_rmse_dtheta": 0.4244548976421356,
      "pose_rmse_dx": 0.19742541015148163,
      "pose_rmse_dy": 0.16190798580646515,
      "pose_rmse_mean": 0.26126277446746826,
      "rmse_dtheta": 0.0490991435945034,
      "rmse_dx": 0.024022158235311508,
      "rmse_dy": 0.010213930159807205,
      "rmse_mean": 0.027778413146734238,
      "rotation_flip": 0.008196720853447914,
      "sparse_tokens": 11195.0,
      "step": 7084,
      "turn_loss": 0.309866338968277,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.3291674409960974,
      "grad_norm": 0.6606444120407104,
      "learning_rate": 3.662534035724104e-06,
      "loss": 0.1529,
      "mae_dtheta": 0.03616568446159363,
      "mae_dx": 0.012077136896550655,
      "mae_dy": 0.004574522841721773,
      "pose_mae_dtheta": 0.29538437724113464,
      "pose_mae_dx": 0.1017874926328659,
      "pose_mae_dy": 0.047488559037446976,
      "pose_rmse_dtheta": 0.5282377600669861,
      "pose_rmse_dx": 0.23340199887752533,
      "pose_rmse_dy": 0.09996471554040909,
      "pose_rmse_mean": 0.28720152378082275,
      "rmse_dtheta": 0.05471467226743698,
      "rmse_dx": 0.0246332585811615,
      "rmse_dy": 0.009387009777128696,
      "rmse_mean": 0.0295783132314682,
      "rotation_flip": 0.015075377188622952,
      "sparse_tokens": 11973.0,
      "step": 7085,
      "turn_loss": 0.24520640075206757,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.3292139007619402,
      "grad_norm": 0.5901869535446167,
      "learning_rate": 3.661260045369203e-06,
      "loss": 0.077,
      "mae_dtheta": 0.0274633951485157,
      "mae_dx": 0.0090599050745368,
      "mae_dy": 0.004083375912159681,
      "pose_mae_dtheta": 0.1935350000858307,
      "pose_mae_dx": 0.0654304027557373,
      "pose_mae_dy": 0.04196067899465561,
      "pose_rmse_dtheta": 0.33646923303604126,
      "pose_rmse_dx": 0.17906077206134796,
      "pose_rmse_dy": 0.09344355016946793,
      "pose_rmse_mean": 0.20299118757247925,
      "rmse_dtheta": 0.04264484718441963,
      "rmse_dx": 0.0221838541328907,
      "rmse_dy": 0.008307901211082935,
      "rmse_mean": 0.02437886968255043,
      "rotation_flip": 0.013961605727672577,
      "sparse_tokens": 10674.0,
      "step": 7086,
      "turn_loss": 0.19186517596244812,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.32926036052778296,
      "grad_norm": 0.7121649980545044,
      "learning_rate": 3.6599861486331074e-06,
      "loss": 0.1091,
      "mae_dtheta": 0.010214490815997124,
      "mae_dx": 0.0029043755494058132,
      "mae_dy": 0.002633742755278945,
      "pose_mae_dtheta": 0.06779329478740692,
      "pose_mae_dx": 0.02944900654256344,
      "pose_mae_dy": 0.0254513006657362,
      "pose_rmse_dtheta": 0.19777098298072815,
      "pose_rmse_dx": 0.10295755416154861,
      "pose_rmse_dy": 0.07045502215623856,
      "pose_rmse_mean": 0.12372785061597824,
      "rmse_dtheta": 0.024291597306728363,
      "rmse_dx": 0.010712423361837864,
      "rmse_dy": 0.006941533647477627,
      "rmse_mean": 0.013981851749122143,
      "rotation_flip": 0.005542725324630737,
      "sparse_tokens": 32089.0,
      "step": 7087,
      "turn_loss": 0.10256350785493851,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.32930682029362573,
      "grad_norm": 0.5537943840026855,
      "learning_rate": 3.658712345604897e-06,
      "loss": 0.1029,
      "mae_dtheta": 0.006832475773990154,
      "mae_dx": 0.0015095925191417336,
      "mae_dy": 0.0020327165257185698,
      "pose_mae_dtheta": 0.044503409415483475,
      "pose_mae_dx": 0.01731918938457966,
      "pose_mae_dy": 0.021759305149316788,
      "pose_rmse_dtheta": 0.11347551643848419,
      "pose_rmse_dx": 0.045985475182533264,
      "pose_rmse_dy": 0.05163378641009331,
      "pose_rmse_mean": 0.07036492973566055,
      "rmse_dtheta": 0.017332637682557106,
      "rmse_dx": 0.004505216609686613,
      "rmse_dy": 0.004642344545572996,
      "rmse_mean": 0.008826733566820621,
      "rotation_flip": 0.0036439355462789536,
      "sparse_tokens": 32057.0,
      "step": 7088,
      "turn_loss": 0.06196657940745354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3293532800594685,
      "grad_norm": 0.5074418783187866,
      "learning_rate": 3.6574386363736532e-06,
      "loss": 0.1546,
      "mae_dtheta": 0.011812586337327957,
      "mae_dx": 0.002289940370246768,
      "mae_dy": 0.0028491837438195944,
      "pose_mae_dtheta": 0.0806545689702034,
      "pose_mae_dx": 0.026691589504480362,
      "pose_mae_dy": 0.030701203271746635,
      "pose_rmse_dtheta": 0.20112089812755585,
      "pose_rmse_dx": 0.07384106516838074,
      "pose_rmse_dy": 0.07872997224330902,
      "pose_rmse_mean": 0.11789731681346893,
      "rmse_dtheta": 0.026033077389001846,
      "rmse_dx": 0.006856558378785849,
      "rmse_dy": 0.0068652210757136345,
      "rmse_mean": 0.013251619413495064,
      "rotation_flip": 0.006862371228635311,
      "sparse_tokens": 32153.0,
      "step": 7089,
      "turn_loss": 0.10201819986104965,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3293997398253113,
      "grad_norm": 0.5466559529304504,
      "learning_rate": 3.656165021028448e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.00848922599107027,
      "mae_dx": 0.0024567823857069016,
      "mae_dy": 0.001463835476897657,
      "pose_mae_dtheta": 0.058714546263217926,
      "pose_mae_dx": 0.018171904608607292,
      "pose_mae_dy": 0.01813075877726078,
      "pose_rmse_dtheta": 0.18337300419807434,
      "pose_rmse_dx": 0.0535002201795578,
      "pose_rmse_dy": 0.06637869030237198,
      "pose_rmse_mean": 0.10108397901058197,
      "rmse_dtheta": 0.023632921278476715,
      "rmse_dx": 0.007816387340426445,
      "rmse_dy": 0.004711325746029615,
      "rmse_mean": 0.01205354556441307,
      "rotation_flip": 0.005763688590377569,
      "sparse_tokens": 32185.0,
      "step": 7090,
      "turn_loss": 0.07588548958301544,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.32944619959115407,
      "grad_norm": 0.5241073369979858,
      "learning_rate": 3.6548914996583417e-06,
      "loss": 0.0905,
      "mae_dtheta": 0.02920360490679741,
      "mae_dx": 0.016842752695083618,
      "mae_dy": 0.004482872784137726,
      "pose_mae_dtheta": 0.23277515172958374,
      "pose_mae_dx": 0.12411856651306152,
      "pose_mae_dy": 0.06321526318788528,
      "pose_rmse_dtheta": 0.387378454208374,
      "pose_rmse_dx": 0.2688691020011902,
      "pose_rmse_dy": 0.163998082280159,
      "pose_rmse_mean": 0.273415207862854,
      "rmse_dtheta": 0.045043062418699265,
      "rmse_dx": 0.030771173536777496,
      "rmse_dy": 0.009199817664921284,
      "rmse_mean": 0.02833801880478859,
      "rotation_flip": 0.01295641902834177,
      "sparse_tokens": 16366.0,
      "step": 7091,
      "turn_loss": 0.2710743844509125,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.32949265935699684,
      "grad_norm": 0.4854849576950073,
      "learning_rate": 3.6536180723523974e-06,
      "loss": 0.0907,
      "mae_dtheta": 0.007068293634802103,
      "mae_dx": 0.0011721414048224688,
      "mae_dy": 0.0013231808552518487,
      "pose_mae_dtheta": 0.04662926495075226,
      "pose_mae_dx": 0.01161460392177105,
      "pose_mae_dy": 0.01747199520468712,
      "pose_rmse_dtheta": 0.1509687900543213,
      "pose_rmse_dx": 0.03348320722579956,
      "pose_rmse_dy": 0.044684357941150665,
      "pose_rmse_mean": 0.07637878507375717,
      "rmse_dtheta": 0.020578470081090927,
      "rmse_dx": 0.004380859900265932,
      "rmse_dy": 0.0039342171512544155,
      "rmse_mean": 0.009631182998418808,
      "rotation_flip": 0.003761418629437685,
      "sparse_tokens": 32073.0,
      "step": 7092,
      "turn_loss": 0.05818842351436615,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.3295391191228396,
      "grad_norm": 0.5468601584434509,
      "learning_rate": 3.6523447391996613e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.03245199844241142,
      "mae_dx": 0.009023584425449371,
      "mae_dy": 0.002736732130870223,
      "pose_mae_dtheta": 0.26695382595062256,
      "pose_mae_dx": 0.06333453208208084,
      "pose_mae_dy": 0.03484530746936798,
      "pose_rmse_dtheta": 0.49068185687065125,
      "pose_rmse_dx": 0.14494629204273224,
      "pose_rmse_dy": 0.08028626441955566,
      "pose_rmse_mean": 0.23863814771175385,
      "rmse_dtheta": 0.05237298458814621,
      "rmse_dx": 0.019687065854668617,
      "rmse_dy": 0.005978986620903015,
      "rmse_mean": 0.02601301297545433,
      "rotation_flip": 0.007215007208287716,
      "sparse_tokens": 11092.0,
      "step": 7093,
      "turn_loss": 0.24022862315177917,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 20388.0,
      "epoch": 0.3295855788886824,
      "grad_norm": 0.6305409073829651,
      "learning_rate": 3.6510715002891805e-06,
      "loss": 0.2029,
      "mae_dtheta": 0.04346904158592224,
      "mae_dx": 0.018285103142261505,
      "mae_dy": 0.006000007502734661,
      "pose_mae_dtheta": 0.33592191338539124,
      "pose_mae_dx": 0.14792421460151672,
      "pose_mae_dy": 0.08334124088287354,
      "pose_rmse_dtheta": 0.5406811237335205,
      "pose_rmse_dx": 0.27625924348831177,
      "pose_rmse_dy": 0.20042866468429565,
      "pose_rmse_mean": 0.339123010635376,
      "rmse_dtheta": 0.060160767287015915,
      "rmse_dx": 0.031276486814022064,
      "rmse_dy": 0.011587265878915787,
      "rmse_mean": 0.03434150665998459,
      "rotation_flip": 0.015400410629808903,
      "sparse_tokens": 15864.0,
      "step": 7094,
      "turn_loss": 0.38366639614105225,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.3296320386545252,
      "grad_norm": 0.4866759777069092,
      "learning_rate": 3.649798355709997e-06,
      "loss": 0.0922,
      "mae_dtheta": 0.03604264557361603,
      "mae_dx": 0.01034956332296133,
      "mae_dy": 0.0053891632705926895,
      "pose_mae_dtheta": 0.2887057363986969,
      "pose_mae_dx": 0.09339506924152374,
      "pose_mae_dy": 0.08617568016052246,
      "pose_rmse_dtheta": 0.5002220273017883,
      "pose_rmse_dx": 0.20906910300254822,
      "pose_rmse_dy": 0.17944003641605377,
      "pose_rmse_mean": 0.29624372720718384,
      "rmse_dtheta": 0.05406844615936279,
      "rmse_dx": 0.02260611392557621,
      "rmse_dy": 0.009303241036832333,
      "rmse_mean": 0.028659267351031303,
      "rotation_flip": 0.009864364750683308,
      "sparse_tokens": 12570.0,
      "step": 7095,
      "turn_loss": 0.3027510941028595,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.32967849842036795,
      "grad_norm": 0.38913077116012573,
      "learning_rate": 3.648525305551136e-06,
      "loss": 0.0896,
      "mae_dtheta": 0.006127263884991407,
      "mae_dx": 0.0009714480838738382,
      "mae_dy": 0.0007976931519806385,
      "pose_mae_dtheta": 0.04764910042285919,
      "pose_mae_dx": 0.010111408308148384,
      "pose_mae_dy": 0.01308757346123457,
      "pose_rmse_dtheta": 0.18227584660053253,
      "pose_rmse_dx": 0.028172502294182777,
      "pose_rmse_dy": 0.038486383855342865,
      "pose_rmse_mean": 0.0829782485961914,
      "rmse_dtheta": 0.01858847588300705,
      "rmse_dx": 0.0031579947099089622,
      "rmse_dy": 0.0018358489032834768,
      "rmse_mean": 0.007860774174332619,
      "rotation_flip": 0.0015731515595689416,
      "sparse_tokens": 32121.0,
      "step": 7096,
      "turn_loss": 0.04554668441414833,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3297249581862107,
      "grad_norm": 0.6795811057090759,
      "learning_rate": 3.647252349901629e-06,
      "loss": 0.1516,
      "mae_dtheta": 0.011864394880831242,
      "mae_dx": 0.002567998832091689,
      "mae_dy": 0.0029164261650294065,
      "pose_mae_dtheta": 0.08676252514123917,
      "pose_mae_dx": 0.030463580042123795,
      "pose_mae_dy": 0.031223274767398834,
      "pose_rmse_dtheta": 0.23920853435993195,
      "pose_rmse_dx": 0.09071868658065796,
      "pose_rmse_dy": 0.08658935129642487,
      "pose_rmse_mean": 0.13883885741233826,
      "rmse_dtheta": 0.028157351538538933,
      "rmse_dx": 0.00790273305028677,
      "rmse_dy": 0.008083374239504337,
      "rmse_mean": 0.014714485965669155,
      "rotation_flip": 0.007684918120503426,
      "sparse_tokens": 32073.0,
      "step": 7097,
      "turn_loss": 0.10195818543434143,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.3297714179520535,
      "grad_norm": 0.5912460684776306,
      "learning_rate": 3.645979488850489e-06,
      "loss": 0.1287,
      "mae_dtheta": 0.03795645013451576,
      "mae_dx": 0.011691445484757423,
      "mae_dy": 0.004989678040146828,
      "pose_mae_dtheta": 0.34008073806762695,
      "pose_mae_dx": 0.08945664018392563,
      "pose_mae_dy": 0.05900120362639427,
      "pose_rmse_dtheta": 0.5642500519752502,
      "pose_rmse_dx": 0.18679307401180267,
      "pose_rmse_dy": 0.1436033993959427,
      "pose_rmse_mean": 0.29821550846099854,
      "rmse_dtheta": 0.057441581040620804,
      "rmse_dx": 0.023105919361114502,
      "rmse_dy": 0.00949733704328537,
      "rmse_mean": 0.030014945194125175,
      "rotation_flip": 0.020527860149741173,
      "sparse_tokens": 16744.0,
      "step": 7098,
      "turn_loss": 0.2849084734916687,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3298178777178963,
      "grad_norm": 0.48899269104003906,
      "learning_rate": 3.6447067224867306e-06,
      "loss": 0.0948,
      "mae_dtheta": 0.007978994399309158,
      "mae_dx": 0.0014176926342770457,
      "mae_dy": 0.0017838276689872146,
      "pose_mae_dtheta": 0.05561237037181854,
      "pose_mae_dx": 0.017231322824954987,
      "pose_mae_dy": 0.024038178846240044,
      "pose_rmse_dtheta": 0.11491535604000092,
      "pose_rmse_dx": 0.03776390850543976,
      "pose_rmse_dy": 0.05497925728559494,
      "pose_rmse_mean": 0.06921951472759247,
      "rmse_dtheta": 0.016366280615329742,
      "rmse_dx": 0.004012275952845812,
      "rmse_dy": 0.003950907848775387,
      "rmse_mean": 0.008109821937978268,
      "rotation_flip": 0.0029607696924358606,
      "sparse_tokens": 32137.0,
      "step": 7099,
      "turn_loss": 0.06449592113494873,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22649.0,
      "epoch": 0.32986433748373906,
      "grad_norm": 0.4439851641654968,
      "learning_rate": 3.6434340508993586e-06,
      "loss": 0.1273,
      "mae_dtheta": 0.03720982000231743,
      "mae_dx": 0.013251608237624168,
      "mae_dy": 0.00464621651917696,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44398507475852966,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 140.7467041015625,
      "model/head/act_norm_mean": 110.00691964285714,
      "model/head/act_norm_min": 73.64102172851562,
      "model/head/act_over_embed": 75.59778507957948,
      "model/head/grad_frac": 0.11044541746377945,
      "model/head/grad_norm": 0.049036115407943726,
      "model/head/grad_zero_frac": 0.00020083303388673812,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6947126116071428,
      "model/head/update_ratio": 0.0008362493827007711,
      "model/head/weight_delta": 9.421220779418945,
      "model/head/weight_delta_rel": 0.16527612507343292,
      "model/head/weight_norm": 58.63814926147461,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4217626750469208,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4217626750469208,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4217626750469208,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28983925889661905,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09022875130176544,
      "model/modality_embedder.encoders.pose/grad_norm": 0.040060218423604965,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012940269662067294,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0253653526306152,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09884811192750931,
      "model/modality_embedder.encoders.pose/weight_norm": 30.957792282104492,
      "model/modality_embedder/grad_frac": 0.09022875130176544,
      "model/modality_embedder/grad_norm": 0.040060218423604965,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0012940269662067294,
      "model/modality_embedder/weight_delta": 3.0253653526306152,
      "model/modality_embedder/weight_delta_rel": 0.09884811192750931,
      "model/modality_embedder/weight_norm": 30.957792282104492,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.31488037109375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.643664965986396,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.15056037902832,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.248147920104774,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06438453495502472,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.028585772961378098,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001024476601742208,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4748401641845703,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09018466621637344,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.902807235717773,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.56208801269531,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.440607284580498,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.728753089904785,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.79581414253418,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06682407110929489,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.029668891802430153,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0003429632051847875,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009998049354180694,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1390974521636963,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10874079167842865,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.674680709838867,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.05545806884766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.030355371315192,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.196678161621094,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.888303911194342,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07050710171461105,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03130410239100456,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010216779774054885,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.3885223865509033,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11378023773431778,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.639890670776367,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 80.50361633300781,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.91282773526077,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.00786304473877,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.181956543681686,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08356089144945145,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03709978982806206,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001241736114025116,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.8997223377227783,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09909874945878983,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.877355575561523,
      "model/normalizer/grad_frac": 0.29109594225883484,
      "model/normalizer/grad_norm": 0.12924225628376007,
      "model/normalizer/grad_zero_frac": 0.0002540737623348832,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016453382559120655,
      "model/normalizer/weight_delta": 6.128599643707275,
      "model/normalizer/weight_delta_rel": 0.07893281430006027,
      "model/normalizer/weight_norm": 78.55056762695312,
      "pose_mae_dtheta": 0.32372838258743286,
      "pose_mae_dx": 0.11078884452581406,
      "pose_mae_dy": 0.057185303419828415,
      "pose_rmse_dtheta": 0.5628837943077087,
      "pose_rmse_dx": 0.24489034712314606,
      "pose_rmse_dy": 0.1261158585548401,
      "pose_rmse_mean": 0.311296671628952,
      "rmse_dtheta": 0.05696221813559532,
      "rmse_dx": 0.02690083719789982,
      "rmse_dy": 0.009097622707486153,
      "rmse_mean": 0.03098689392209053,
      "rotation_flip": 0.007352941203862429,
      "sparse_tokens": 18408.0,
      "step": 7100,
      "turn_loss": 0.26832810044288635,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.3299107972495819,
      "grad_norm": 0.6249576807022095,
      "learning_rate": 3.6421614741773702e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.03468181937932968,
      "mae_dx": 0.00565028190612793,
      "mae_dy": 0.004548350349068642,
      "pose_mae_dtheta": 0.2724076509475708,
      "pose_mae_dx": 0.04734337702393532,
      "pose_mae_dy": 0.05810169130563736,
      "pose_rmse_dtheta": 0.5250920653343201,
      "pose_rmse_dx": 0.10817937552928925,
      "pose_rmse_dy": 0.12096618115901947,
      "pose_rmse_mean": 0.251412570476532,
      "rmse_dtheta": 0.056967299431562424,
      "rmse_dx": 0.01306930836290121,
      "rmse_dy": 0.008245658129453659,
      "rmse_mean": 0.026094090193510056,
      "rotation_flip": 0.012658228166401386,
      "sparse_tokens": 4947.0,
      "step": 7101,
      "turn_loss": 0.20275576412677765,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.32995725701542467,
      "grad_norm": 0.5485420227050781,
      "learning_rate": 3.640888992409761e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.04624573141336441,
      "mae_dx": 0.018793176859617233,
      "mae_dy": 0.007410451304167509,
      "pose_mae_dtheta": 0.397697776556015,
      "pose_mae_dx": 0.12331569939851761,
      "pose_mae_dy": 0.082179494202137,
      "pose_rmse_dtheta": 0.5643537044525146,
      "pose_rmse_dx": 0.24166132509708405,
      "pose_rmse_dy": 0.18997247517108917,
      "pose_rmse_mean": 0.3319958448410034,
      "rmse_dtheta": 0.05904040485620499,
      "rmse_dx": 0.03192479908466339,
      "rmse_dy": 0.01260603591799736,
      "rmse_mean": 0.034523747861385345,
      "rotation_flip": 0.019083969295024872,
      "sparse_tokens": 4861.0,
      "step": 7102,
      "turn_loss": 0.33169275522232056,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 22649.0,
      "epoch": 0.33000371678126744,
      "grad_norm": 0.5587866902351379,
      "learning_rate": 3.6396166056855125e-06,
      "loss": 0.1409,
      "mae_dtheta": 0.041982460767030716,
      "mae_dx": 0.012551622465252876,
      "mae_dy": 0.0035651710350066423,
      "pose_mae_dtheta": 0.32594093680381775,
      "pose_mae_dx": 0.09923882782459259,
      "pose_mae_dy": 0.03951403498649597,
      "pose_rmse_dtheta": 0.5698697566986084,
      "pose_rmse_dx": 0.2229587882757187,
      "pose_rmse_dy": 0.10524457693099976,
      "pose_rmse_mean": 0.29935771226882935,
      "rmse_dtheta": 0.0618419386446476,
      "rmse_dx": 0.02436712570488453,
      "rmse_dy": 0.00796359684318304,
      "rmse_mean": 0.03139089047908783,
      "rotation_flip": 0.002819548826664686,
      "sparse_tokens": 18719.0,
      "step": 7103,
      "turn_loss": 0.33637723326683044,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.3300501765471102,
      "grad_norm": 0.5745090246200562,
      "learning_rate": 3.6383443140936064e-06,
      "loss": 0.1486,
      "mae_dtheta": 0.03247249871492386,
      "mae_dx": 0.009564771316945553,
      "mae_dy": 0.004087142180651426,
      "pose_mae_dtheta": 0.26807376742362976,
      "pose_mae_dx": 0.07188189774751663,
      "pose_mae_dy": 0.037255868315696716,
      "pose_rmse_dtheta": 0.42409777641296387,
      "pose_rmse_dx": 0.16249948740005493,
      "pose_rmse_dy": 0.09338930249214172,
      "pose_rmse_mean": 0.22666220366954803,
      "rmse_dtheta": 0.04967614635825157,
      "rmse_dx": 0.019964536651968956,
      "rmse_dy": 0.010506569407880306,
      "rmse_mean": 0.026715751737356186,
      "rotation_flip": 0.011320754885673523,
      "sparse_tokens": 8627.0,
      "step": 7104,
      "turn_loss": 0.29414451122283936,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.330096636312953,
      "grad_norm": 0.5243234038352966,
      "learning_rate": 3.637072117723012e-06,
      "loss": 0.1431,
      "mae_dtheta": 0.03239012509584427,
      "mae_dx": 0.00892569962888956,
      "mae_dy": 0.004853017162531614,
      "pose_mae_dtheta": 0.22967782616615295,
      "pose_mae_dx": 0.07486595213413239,
      "pose_mae_dy": 0.06734386831521988,
      "pose_rmse_dtheta": 0.44524717330932617,
      "pose_rmse_dx": 0.20081442594528198,
      "pose_rmse_dy": 0.12839250266551971,
      "pose_rmse_mean": 0.2581513822078705,
      "rmse_dtheta": 0.04965503141283989,
      "rmse_dx": 0.021697549149394035,
      "rmse_dy": 0.009054891765117645,
      "rmse_mean": 0.026802491396665573,
      "rotation_flip": 0.007936508394777775,
      "sparse_tokens": 9212.0,
      "step": 7105,
      "turn_loss": 0.19521276652812958,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.3301430960787958,
      "grad_norm": 0.6213985085487366,
      "learning_rate": 3.6358000166626966e-06,
      "loss": 0.2218,
      "mae_dtheta": 0.04369424656033516,
      "mae_dx": 0.015070348978042603,
      "mae_dy": 0.003981550689786673,
      "pose_mae_dtheta": 0.32440635561943054,
      "pose_mae_dx": 0.13197849690914154,
      "pose_mae_dy": 0.058153603225946426,
      "pose_rmse_dtheta": 0.5692392587661743,
      "pose_rmse_dx": 0.29744935035705566,
      "pose_rmse_dy": 0.12674710154533386,
      "pose_rmse_mean": 0.3311452567577362,
      "rmse_dtheta": 0.06306084245443344,
      "rmse_dx": 0.029604990035295486,
      "rmse_dy": 0.007529418915510178,
      "rmse_mean": 0.03339841961860657,
      "rotation_flip": 0.018817204982042313,
      "sparse_tokens": 5969.0,
      "step": 7106,
      "turn_loss": 0.3128916323184967,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.33018955584463855,
      "grad_norm": 0.5427772402763367,
      "learning_rate": 3.6345280110016167e-06,
      "loss": 0.1122,
      "mae_dtheta": 0.009849685244262218,
      "mae_dx": 0.0018698069034144282,
      "mae_dy": 0.001624917727895081,
      "pose_mae_dtheta": 0.07023370265960693,
      "pose_mae_dx": 0.02061537094414234,
      "pose_mae_dy": 0.019986260682344437,
      "pose_rmse_dtheta": 0.22223235666751862,
      "pose_rmse_dx": 0.052967481315135956,
      "pose_rmse_dy": 0.04843800887465477,
      "pose_rmse_mean": 0.10787928104400635,
      "rmse_dtheta": 0.026339339092373848,
      "rmse_dx": 0.005441725254058838,
      "rmse_dy": 0.004004177171736956,
      "rmse_mean": 0.011928413063287735,
      "rotation_flip": 0.0019550342112779617,
      "sparse_tokens": 32153.0,
      "step": 7107,
      "turn_loss": 0.0775306224822998,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.3302360156104813,
      "grad_norm": 0.5308881998062134,
      "learning_rate": 3.633256100828726e-06,
      "loss": 0.1709,
      "mae_dtheta": 0.0370509959757328,
      "mae_dx": 0.0067356303334236145,
      "mae_dy": 0.006507291458547115,
      "pose_mae_dtheta": 0.3008579909801483,
      "pose_mae_dx": 0.04653894901275635,
      "pose_mae_dy": 0.061951644718647,
      "pose_rmse_dtheta": 0.5820600986480713,
      "pose_rmse_dx": 0.094219870865345,
      "pose_rmse_dy": 0.12804430723190308,
      "pose_rmse_mean": 0.2681080996990204,
      "rmse_dtheta": 0.059575315564870834,
      "rmse_dx": 0.015769628807902336,
      "rmse_dy": 0.012479821220040321,
      "rmse_mean": 0.029274921864271164,
      "rotation_flip": 0.005934718064963818,
      "sparse_tokens": 5138.0,
      "step": 7108,
      "turn_loss": 0.2506844401359558,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.3302824753763241,
      "grad_norm": 0.4544173777103424,
      "learning_rate": 3.6319842862329723e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.03207927942276001,
      "mae_dx": 0.012740966863930225,
      "mae_dy": 0.005394995212554932,
      "pose_mae_dtheta": 0.23614129424095154,
      "pose_mae_dx": 0.10375376790761948,
      "pose_mae_dy": 0.06570903211832047,
      "pose_rmse_dtheta": 0.4257524907588959,
      "pose_rmse_dx": 0.21777752041816711,
      "pose_rmse_dy": 0.14062243700027466,
      "pose_rmse_mean": 0.26138415932655334,
      "rmse_dtheta": 0.049068205058574677,
      "rmse_dx": 0.02499377354979515,
      "rmse_dy": 0.01022319495677948,
      "rmse_mean": 0.028095057234168053,
      "rotation_flip": 0.015214384533464909,
      "sparse_tokens": 12895.0,
      "step": 7109,
      "turn_loss": 0.22985732555389404,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3303289351421669,
      "grad_norm": 0.43814077973365784,
      "learning_rate": 3.6307125673032897e-06,
      "loss": 0.0866,
      "mae_dtheta": 0.012496627867221832,
      "mae_dx": 0.001920128590427339,
      "mae_dy": 0.003029115963727236,
      "pose_mae_dtheta": 0.0794125571846962,
      "pose_mae_dx": 0.025136223062872887,
      "pose_mae_dy": 0.03249109908938408,
      "pose_rmse_dtheta": 0.19021527469158173,
      "pose_rmse_dx": 0.06125230714678764,
      "pose_rmse_dy": 0.07161454111337662,
      "pose_rmse_mean": 0.10769404470920563,
      "rmse_dtheta": 0.024860819801688194,
      "rmse_dx": 0.004906622227281332,
      "rmse_dy": 0.006172495894134045,
      "rmse_mean": 0.011979980394244194,
      "rotation_flip": 0.007549759931862354,
      "sparse_tokens": 32153.0,
      "step": 7110,
      "turn_loss": 0.11230622231960297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.33037539490800966,
      "grad_norm": 0.3776330053806305,
      "learning_rate": 3.6294409441286133e-06,
      "loss": 0.0911,
      "mae_dtheta": 0.009163669310510159,
      "mae_dx": 0.001989589538425207,
      "mae_dy": 0.0025999543722718954,
      "pose_mae_dtheta": 0.06304673850536346,
      "pose_mae_dx": 0.021948805078864098,
      "pose_mae_dy": 0.02694859355688095,
      "pose_rmse_dtheta": 0.17794211208820343,
      "pose_rmse_dx": 0.06163470447063446,
      "pose_rmse_dy": 0.06973220407962799,
      "pose_rmse_mean": 0.10310300439596176,
      "rmse_dtheta": 0.022295033559203148,
      "rmse_dx": 0.0063632489182055,
      "rmse_dy": 0.0063297501765191555,
      "rmse_mean": 0.011662676930427551,
      "rotation_flip": 0.006722024641931057,
      "sparse_tokens": 32121.0,
      "step": 7111,
      "turn_loss": 0.09528389573097229,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.33042185467385243,
      "grad_norm": 0.4364619255065918,
      "learning_rate": 3.6281694167978655e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.0062111313454806805,
      "mae_dx": 0.0010761957382783294,
      "mae_dy": 0.0007316602859646082,
      "pose_mae_dtheta": 0.04316413030028343,
      "pose_mae_dx": 0.009300924837589264,
      "pose_mae_dy": 0.011765091679990292,
      "pose_rmse_dtheta": 0.16303028166294098,
      "pose_rmse_dx": 0.03570682927966118,
      "pose_rmse_dy": 0.031830258667469025,
      "pose_rmse_mean": 0.07685579359531403,
      "rmse_dtheta": 0.019767628982663155,
      "rmse_dx": 0.004660141654312611,
      "rmse_dy": 0.0016725865425541997,
      "rmse_mean": 0.008700119331479073,
      "rotation_flip": 0.001178550417535007,
      "sparse_tokens": 32089.0,
      "step": 7112,
      "turn_loss": 0.037873513996601105,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3304683144396952,
      "grad_norm": 0.4926135540008545,
      "learning_rate": 3.6268979853999674e-06,
      "loss": 0.1373,
      "mae_dtheta": 0.006971820257604122,
      "mae_dx": 0.0014828406274318695,
      "mae_dy": 0.001801712205633521,
      "pose_mae_dtheta": 0.04423980787396431,
      "pose_mae_dx": 0.018683327361941338,
      "pose_mae_dy": 0.019536294043064117,
      "pose_rmse_dtheta": 0.1056535616517067,
      "pose_rmse_dx": 0.05784827843308449,
      "pose_rmse_dy": 0.052051253616809845,
      "pose_rmse_mean": 0.07185103744268417,
      "rmse_dtheta": 0.016651075333356857,
      "rmse_dx": 0.004328523296862841,
      "rmse_dy": 0.005087947007268667,
      "rmse_mean": 0.008689181879162788,
      "rotation_flip": 0.0027058369014412165,
      "sparse_tokens": 32153.0,
      "step": 7113,
      "turn_loss": 0.060563135892152786,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.330514774205538,
      "grad_norm": 0.44991427659988403,
      "learning_rate": 3.6256266500238312e-06,
      "loss": 0.0879,
      "mae_dtheta": 0.010970303788781166,
      "mae_dx": 0.0018508454086259007,
      "mae_dy": 0.0024510039947927,
      "pose_mae_dtheta": 0.07949497550725937,
      "pose_mae_dx": 0.02967119589447975,
      "pose_mae_dy": 0.030765783041715622,
      "pose_rmse_dtheta": 0.2220091074705124,
      "pose_rmse_dx": 0.10009714215993881,
      "pose_rmse_dy": 0.07595840096473694,
      "pose_rmse_mean": 0.1326882243156433,
      "rmse_dtheta": 0.025199268013238907,
      "rmse_dx": 0.006376652512699366,
      "rmse_dy": 0.00660321582108736,
      "rmse_mean": 0.012726379558444023,
      "rotation_flip": 0.004708097781985998,
      "sparse_tokens": 32041.0,
      "step": 7114,
      "turn_loss": 0.08869870752096176,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.33056123397138076,
      "grad_norm": 0.38444340229034424,
      "learning_rate": 3.6243554107583603e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.00668287230655551,
      "mae_dx": 0.001376183470711112,
      "mae_dy": 0.0010158903896808624,
      "pose_mae_dtheta": 0.0448790080845356,
      "pose_mae_dx": 0.013476996682584286,
      "pose_mae_dy": 0.014169623143970966,
      "pose_rmse_dtheta": 0.14577418565750122,
      "pose_rmse_dx": 0.04061855748295784,
      "pose_rmse_dy": 0.039527419954538345,
      "pose_rmse_mean": 0.0753067210316658,
      "rmse_dtheta": 0.01916370913386345,
      "rmse_dx": 0.004795886110514402,
      "rmse_dy": 0.002484942087903619,
      "rmse_mean": 0.00881484616547823,
      "rotation_flip": 0.00637348648160696,
      "sparse_tokens": 32073.0,
      "step": 7115,
      "turn_loss": 0.05031782388687134,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.33060769373722354,
      "grad_norm": 0.5199815630912781,
      "learning_rate": 3.623084267692455e-06,
      "loss": 0.1322,
      "mae_dtheta": 0.012085882015526295,
      "mae_dx": 0.0034365609753876925,
      "mae_dy": 0.0027458304539322853,
      "pose_mae_dtheta": 0.08062436431646347,
      "pose_mae_dx": 0.0360858291387558,
      "pose_mae_dy": 0.028952544555068016,
      "pose_rmse_dtheta": 0.22429108619689941,
      "pose_rmse_dx": 0.09591890126466751,
      "pose_rmse_dy": 0.06930184364318848,
      "pose_rmse_mean": 0.1298372745513916,
      "rmse_dtheta": 0.027406496927142143,
      "rmse_dx": 0.010583635419607162,
      "rmse_dy": 0.006858078762888908,
      "rmse_mean": 0.014949403703212738,
      "rotation_flip": 0.001818181830458343,
      "sparse_tokens": 32137.0,
      "step": 7116,
      "turn_loss": 0.1318921148777008,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13971.0,
      "epoch": 0.3306541535030663,
      "grad_norm": 0.5331658720970154,
      "learning_rate": 3.6218132209150047e-06,
      "loss": 0.1379,
      "mae_dtheta": 0.03346451744437218,
      "mae_dx": 0.008796030655503273,
      "mae_dy": 0.005436926614493132,
      "pose_mae_dtheta": 0.24980762600898743,
      "pose_mae_dx": 0.06932903081178665,
      "pose_mae_dy": 0.05842360854148865,
      "pose_rmse_dtheta": 0.46030953526496887,
      "pose_rmse_dx": 0.15254025161266327,
      "pose_rmse_dy": 0.1613762378692627,
      "pose_rmse_mean": 0.2580753564834595,
      "rmse_dtheta": 0.05312308296561241,
      "rmse_dx": 0.019420841708779335,
      "rmse_dy": 0.011609322391450405,
      "rmse_mean": 0.028051083907485008,
      "rotation_flip": 0.012383900582790375,
      "sparse_tokens": 10631.0,
      "step": 7117,
      "turn_loss": 0.244432270526886,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.33070061326890915,
      "grad_norm": 0.6995568871498108,
      "learning_rate": 3.620542270514896e-06,
      "loss": 0.2049,
      "mae_dtheta": 0.011078698560595512,
      "mae_dx": 0.0012938716681674123,
      "mae_dy": 0.0015762323746457696,
      "pose_mae_dtheta": 0.07346660643815994,
      "pose_mae_dx": 0.016493048518896103,
      "pose_mae_dy": 0.027146199718117714,
      "pose_rmse_dtheta": 0.18115811049938202,
      "pose_rmse_dx": 0.03933039680123329,
      "pose_rmse_dy": 0.062173403799533844,
      "pose_rmse_mean": 0.09422063827514648,
      "rmse_dtheta": 0.024172835052013397,
      "rmse_dx": 0.0043908716179430485,
      "rmse_dy": 0.0028847381472587585,
      "rmse_mean": 0.010482816025614738,
      "rotation_flip": 0.003370786551386118,
      "sparse_tokens": 32089.0,
      "step": 7118,
      "turn_loss": 0.07337342202663422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.3307470730347519,
      "grad_norm": 0.5250800251960754,
      "learning_rate": 3.6192714165810073e-06,
      "loss": 0.1462,
      "mae_dtheta": 0.02732538990676403,
      "mae_dx": 0.008817901834845543,
      "mae_dy": 0.006191318854689598,
      "pose_mae_dtheta": 0.19928082823753357,
      "pose_mae_dx": 0.07790306210517883,
      "pose_mae_dy": 0.09137124568223953,
      "pose_rmse_dtheta": 0.3381260931491852,
      "pose_rmse_dx": 0.19358481466770172,
      "pose_rmse_dy": 0.18056891858577728,
      "pose_rmse_mean": 0.23742662370204926,
      "rmse_dtheta": 0.0385284386575222,
      "rmse_dx": 0.021403437480330467,
      "rmse_dy": 0.009503437206149101,
      "rmse_mean": 0.023145105689764023,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 10512.0,
      "step": 7119,
      "turn_loss": 0.21729899942874908,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 34282.0,
      "epoch": 0.3307935328005947,
      "grad_norm": 0.8307980895042419,
      "learning_rate": 3.618000659202208e-06,
      "loss": 0.2496,
      "mae_dtheta": 0.03950384631752968,
      "mae_dx": 0.015053297393023968,
      "mae_dy": 0.007212393917143345,
      "pose_mae_dtheta": 0.3088206350803375,
      "pose_mae_dx": 0.10885140299797058,
      "pose_mae_dy": 0.08697527647018433,
      "pose_rmse_dtheta": 0.5278107523918152,
      "pose_rmse_dx": 0.235910564661026,
      "pose_rmse_dy": 0.2295507937669754,
      "pose_rmse_mean": 0.3310907185077667,
      "rmse_dtheta": 0.05760010704398155,
      "rmse_dx": 0.02923828922212124,
      "rmse_dy": 0.01562848873436451,
      "rmse_mean": 0.03415562957525253,
      "rotation_flip": 0.014687882736325264,
      "sparse_tokens": 25216.0,
      "step": 7120,
      "turn_loss": 0.34448349475860596,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.3308399925664375,
      "grad_norm": 0.45745208859443665,
      "learning_rate": 3.6167299984673655e-06,
      "loss": 0.0704,
      "mae_dtheta": 0.05574312061071396,
      "mae_dx": 0.01745658926665783,
      "mae_dy": 0.017762329429388046,
      "pose_mae_dtheta": 0.45959725975990295,
      "pose_mae_dx": 0.18890966475009918,
      "pose_mae_dy": 0.08378292620182037,
      "pose_rmse_dtheta": 0.7804098725318909,
      "pose_rmse_dx": 0.3752192556858063,
      "pose_rmse_dy": 0.18434888124465942,
      "pose_rmse_mean": 0.4466593265533447,
      "rmse_dtheta": 0.0811748281121254,
      "rmse_dx": 0.03057001903653145,
      "rmse_dy": 0.034864459186792374,
      "rmse_mean": 0.048869770020246506,
      "rotation_flip": 0.014423076994717121,
      "sparse_tokens": 3228.0,
      "step": 7121,
      "turn_loss": 0.5689947009086609,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.33088645233228026,
      "grad_norm": 0.635093092918396,
      "learning_rate": 3.615459434465336e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.03143793344497681,
      "mae_dx": 0.012792294844985008,
      "mae_dy": 0.006606411188840866,
      "pose_mae_dtheta": 0.24585960805416107,
      "pose_mae_dx": 0.10253237932920456,
      "pose_mae_dy": 0.09374760836362839,
      "pose_rmse_dtheta": 0.4381207823753357,
      "pose_rmse_dx": 0.2186884582042694,
      "pose_rmse_dy": 0.17923015356063843,
      "pose_rmse_mean": 0.2786797881126404,
      "rmse_dtheta": 0.0494895875453949,
      "rmse_dx": 0.025234438478946686,
      "rmse_dy": 0.012680048123002052,
      "rmse_mean": 0.029134690761566162,
      "rotation_flip": 0.01550387591123581,
      "sparse_tokens": 16024.0,
      "step": 7122,
      "turn_loss": 0.32363465428352356,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.33093291209812303,
      "grad_norm": 0.37373337149620056,
      "learning_rate": 3.6141889672849728e-06,
      "loss": 0.0694,
      "mae_dtheta": 0.019959505647420883,
      "mae_dx": 0.006787718273699284,
      "mae_dy": 0.0032111157197505236,
      "pose_mae_dtheta": 0.12484641373157501,
      "pose_mae_dx": 0.046292178332805634,
      "pose_mae_dy": 0.03226175531744957,
      "pose_rmse_dtheta": 0.27817264199256897,
      "pose_rmse_dx": 0.14431919157505035,
      "pose_rmse_dy": 0.08549433201551437,
      "pose_rmse_mean": 0.1693287342786789,
      "rmse_dtheta": 0.036496348679065704,
      "rmse_dx": 0.01771417260169983,
      "rmse_dy": 0.007212119176983833,
      "rmse_mean": 0.020474214106798172,
      "rotation_flip": 0.008130080997943878,
      "sparse_tokens": 8137.0,
      "step": 7123,
      "turn_loss": 0.18925389647483826,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 16514.0,
      "epoch": 0.3309793718639658,
      "grad_norm": 0.7438535094261169,
      "learning_rate": 3.6129185970151163e-06,
      "loss": 0.1681,
      "mae_dtheta": 0.03857491910457611,
      "mae_dx": 0.011559202335774899,
      "mae_dy": 0.00582109484821558,
      "pose_mae_dtheta": 0.2840854525566101,
      "pose_mae_dx": 0.0916740894317627,
      "pose_mae_dy": 0.060617923736572266,
      "pose_rmse_dtheta": 0.5380715131759644,
      "pose_rmse_dx": 0.224054753780365,
      "pose_rmse_dy": 0.14168058335781097,
      "pose_rmse_mean": 0.30126896500587463,
      "rmse_dtheta": 0.057951539754867554,
      "rmse_dx": 0.024415886029601097,
      "rmse_dy": 0.012710879556834698,
      "rmse_mean": 0.03169276937842369,
      "rotation_flip": 0.025392986834049225,
      "sparse_tokens": 13466.0,
      "step": 7124,
      "turn_loss": 0.30093637108802795,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3310258316298086,
      "grad_norm": 0.7555800676345825,
      "learning_rate": 3.6116483237446096e-06,
      "loss": 0.1427,
      "mae_dtheta": 0.010843266732990742,
      "mae_dx": 0.0012445375323295593,
      "mae_dy": 0.0026258707512170076,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7555801868438721,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.43646240234375,
      "model/head/act_norm_mean": 111.35444286616162,
      "model/head/act_norm_min": 73.53871154785156,
      "model/head/act_over_embed": 76.5238156543455,
      "model/head/grad_frac": 0.07830040156841278,
      "model/head/grad_norm": 0.05916223302483559,
      "model/head/grad_zero_frac": 0.00016022224735934287,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7061434659090909,
      "model/head/update_ratio": 0.0010089077986776829,
      "model/head/weight_delta": 9.428483009338379,
      "model/head/weight_delta_rel": 0.16540351510047913,
      "model/head/weight_norm": 58.6398811340332,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42187848687171936,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4218141719766332,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.421756774187088,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2898746480688392,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05569543316960335,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04208236560225487,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5193014705882353,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001359344576485455,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0294406414031982,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09898126870393753,
      "model/modality_embedder.encoders.pose/weight_norm": 30.957836151123047,
      "model/modality_embedder/grad_frac": 0.05569543316960335,
      "model/modality_embedder/grad_norm": 0.04208236560225487,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5193014705882353,
      "model/modality_embedder/update_ratio": 0.001359344576485455,
      "model/modality_embedder/weight_delta": 3.0294406414031982,
      "model/modality_embedder/weight_delta_rel": 0.09898126870393753,
      "model/modality_embedder/weight_norm": 30.957836151123047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.18604278564453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.738526134359468,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.024032592773438,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.313337403115,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.055448275059461594,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04189561679959297,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015014210948720574,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.478930950164795,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0903337374329567,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.903974533081055,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.06670379638672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.72913159371493,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.442176818847656,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.9940907489785,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05016930028796196,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03790692985057831,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001277334289625287,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.144207715988159,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10891781002283096,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.676591873168945,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.18653869628906,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.57819264069264,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.540878295898438,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.26478281164385,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05028964579105377,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.037997860461473465,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012400811538100243,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.394026041030884,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11396504193544388,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.64143180847168,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.09192657470703,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.353572931697933,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.676651954650879,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.484840768994843,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.053728170692920685,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04059594124555588,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013587111607193947,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.904254913330078,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09925364702939987,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.878271102905273,
      "model/normalizer/grad_frac": 0.2201722115278244,
      "model/normalizer/grad_norm": 0.16635775566101074,
      "model/normalizer/grad_zero_frac": 0.00021034943347331136,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002117797266691923,
      "model/normalizer/weight_delta": 6.138474464416504,
      "model/normalizer/weight_delta_rel": 0.07905999571084976,
      "model/normalizer/weight_norm": 78.55225372314453,
      "pose_mae_dtheta": 0.07239322364330292,
      "pose_mae_dx": 0.020994743332266808,
      "pose_mae_dy": 0.035264261066913605,
      "pose_rmse_dtheta": 0.1448252946138382,
      "pose_rmse_dx": 0.04896656423807144,
      "pose_rmse_dy": 0.08751307427883148,
      "pose_rmse_mean": 0.09376832097768784,
      "rmse_dtheta": 0.019938241690397263,
      "rmse_dx": 0.003166249953210354,
      "rmse_dy": 0.00508694676682353,
      "rmse_mean": 0.009397147223353386,
      "rotation_flip": 0.005496518686413765,
      "sparse_tokens": 32089.0,
      "step": 7125,
      "turn_loss": 0.09200569987297058,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.33107229139565136,
      "grad_norm": 0.41910406947135925,
      "learning_rate": 3.610378147562279e-06,
      "loss": 0.1066,
      "mae_dtheta": 0.012066267430782318,
      "mae_dx": 0.002707243897020817,
      "mae_dy": 0.002919372171163559,
      "pose_mae_dtheta": 0.08259429037570953,
      "pose_mae_dx": 0.029340500012040138,
      "pose_mae_dy": 0.027393793687224388,
      "pose_rmse_dtheta": 0.20495054125785828,
      "pose_rmse_dx": 0.08185946941375732,
      "pose_rmse_dy": 0.0621669664978981,
      "pose_rmse_mean": 0.11632566154003143,
      "rmse_dtheta": 0.025818757712841034,
      "rmse_dx": 0.007403584197163582,
      "rmse_dy": 0.007587989792227745,
      "rmse_mean": 0.013603444211184978,
      "rotation_flip": 0.007281553465873003,
      "sparse_tokens": 32121.0,
      "step": 7126,
      "turn_loss": 0.10669019818305969,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.33111875116149414,
      "grad_norm": 0.5808078050613403,
      "learning_rate": 3.6091080685569495e-06,
      "loss": 0.1608,
      "mae_dtheta": 0.02900436334311962,
      "mae_dx": 0.010411850176751614,
      "mae_dy": 0.005131436511874199,
      "pose_mae_dtheta": 0.22771570086479187,
      "pose_mae_dx": 0.09252087026834488,
      "pose_mae_dy": 0.04999562352895737,
      "pose_rmse_dtheta": 0.44559916853904724,
      "pose_rmse_dx": 0.21151168644428253,
      "pose_rmse_dy": 0.124514639377594,
      "pose_rmse_mean": 0.2605418562889099,
      "rmse_dtheta": 0.04798775911331177,
      "rmse_dx": 0.021488003432750702,
      "rmse_dy": 0.013083960860967636,
      "rmse_mean": 0.02751990780234337,
      "rotation_flip": 0.01011804398149252,
      "sparse_tokens": 10678.0,
      "step": 7127,
      "turn_loss": 0.2879796028137207,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3311652109273369,
      "grad_norm": 0.7129263281822205,
      "learning_rate": 3.607838086817442e-06,
      "loss": 0.1129,
      "mae_dtheta": 0.00946336705237627,
      "mae_dx": 0.00204275781288743,
      "mae_dy": 0.002458220347762108,
      "pose_mae_dtheta": 0.07120344042778015,
      "pose_mae_dx": 0.020543808117508888,
      "pose_mae_dy": 0.019048158079385757,
      "pose_rmse_dtheta": 0.22639712691307068,
      "pose_rmse_dx": 0.05680173262953758,
      "pose_rmse_dy": 0.04826727509498596,
      "pose_rmse_mean": 0.11048871278762817,
      "rmse_dtheta": 0.025737378746271133,
      "rmse_dx": 0.0064919148571789265,
      "rmse_dy": 0.00770753575488925,
      "rmse_mean": 0.01331227645277977,
      "rotation_flip": 0.0058700209483504295,
      "sparse_tokens": 32153.0,
      "step": 7128,
      "turn_loss": 0.07930900901556015,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3312116706931797,
      "grad_norm": 0.44356420636177063,
      "learning_rate": 3.606568202432562e-06,
      "loss": 0.0963,
      "mae_dtheta": 0.003187471069395542,
      "mae_dx": 0.004656628705561161,
      "mae_dy": 0.00041643061558716,
      "pose_mae_dtheta": 0.023971227928996086,
      "pose_mae_dx": 0.0397920124232769,
      "pose_mae_dy": 0.00592415826395154,
      "pose_rmse_dtheta": 0.10598630458116531,
      "pose_rmse_dx": 0.14072468876838684,
      "pose_rmse_dy": 0.014549643732607365,
      "pose_rmse_mean": 0.08708687871694565,
      "rmse_dtheta": 0.013966074213385582,
      "rmse_dx": 0.01418047770857811,
      "rmse_dy": 0.001178782433271408,
      "rmse_mean": 0.009775111451745033,
      "rotation_flip": 0.0038314175326377153,
      "sparse_tokens": 32089.0,
      "step": 7129,
      "turn_loss": 0.05569477379322052,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.33125813045902247,
      "grad_norm": 0.3947002589702606,
      "learning_rate": 3.6052984154911176e-06,
      "loss": 0.0925,
      "mae_dtheta": 0.007572312839329243,
      "mae_dx": 0.0020391959697008133,
      "mae_dy": 0.001923288800753653,
      "pose_mae_dtheta": 0.054364874958992004,
      "pose_mae_dx": 0.016173025593161583,
      "pose_mae_dy": 0.015933414921164513,
      "pose_rmse_dtheta": 0.19300609827041626,
      "pose_rmse_dx": 0.043802861124277115,
      "pose_rmse_dy": 0.03603101521730423,
      "pose_rmse_mean": 0.09094665944576263,
      "rmse_dtheta": 0.021815747022628784,
      "rmse_dx": 0.0072331903502345085,
      "rmse_dy": 0.005725982133299112,
      "rmse_mean": 0.01159164123237133,
      "rotation_flip": 0.005069708451628685,
      "sparse_tokens": 32089.0,
      "step": 7130,
      "turn_loss": 0.07125706225633621,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.33130459022486525,
      "grad_norm": 0.3764714300632477,
      "learning_rate": 3.6040287260819017e-06,
      "loss": 0.0917,
      "mae_dtheta": 0.008746166713535786,
      "mae_dx": 0.001595516107045114,
      "mae_dy": 0.002217587549239397,
      "pose_mae_dtheta": 0.06348975747823715,
      "pose_mae_dx": 0.020763833075761795,
      "pose_mae_dy": 0.027645612135529518,
      "pose_rmse_dtheta": 0.1632038950920105,
      "pose_rmse_dx": 0.054291870445013046,
      "pose_rmse_dy": 0.06801887601613998,
      "pose_rmse_mean": 0.09517155587673187,
      "rmse_dtheta": 0.021181348711252213,
      "rmse_dx": 0.004593422636389732,
      "rmse_dy": 0.005326224956661463,
      "rmse_mean": 0.010366998612880707,
      "rotation_flip": 0.0037174720782786608,
      "sparse_tokens": 32073.0,
      "step": 7131,
      "turn_loss": 0.07038379460573196,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.331351049990708,
      "grad_norm": 0.2785274386405945,
      "learning_rate": 3.6027591342937064e-06,
      "loss": 0.0755,
      "mae_dtheta": 0.00966193713247776,
      "mae_dx": 0.0013998436043038964,
      "mae_dy": 0.001692658057436347,
      "pose_mae_dtheta": 0.07221195846796036,
      "pose_mae_dx": 0.017779525369405746,
      "pose_mae_dy": 0.025179225951433182,
      "pose_rmse_dtheta": 0.19941595196723938,
      "pose_rmse_dx": 0.055840831249952316,
      "pose_rmse_dy": 0.06672605127096176,
      "pose_rmse_mean": 0.10732761025428772,
      "rmse_dtheta": 0.021959839388728142,
      "rmse_dx": 0.00514112738892436,
      "rmse_dy": 0.0040655480697751045,
      "rmse_mean": 0.010388839058578014,
      "rotation_flip": 0.0022956840693950653,
      "sparse_tokens": 32073.0,
      "step": 7132,
      "turn_loss": 0.06811297684907913,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3313975097565508,
      "grad_norm": 0.40065863728523254,
      "learning_rate": 3.6014896402153165e-06,
      "loss": 0.0849,
      "mae_dtheta": 0.011098085902631283,
      "mae_dx": 0.0018715097103267908,
      "mae_dy": 0.0027197659946978092,
      "pose_mae_dtheta": 0.07785745710134506,
      "pose_mae_dx": 0.025720462203025818,
      "pose_mae_dy": 0.03154333680868149,
      "pose_rmse_dtheta": 0.1861359030008316,
      "pose_rmse_dx": 0.060235053300857544,
      "pose_rmse_dy": 0.07335736602544785,
      "pose_rmse_mean": 0.106576107442379,
      "rmse_dtheta": 0.023286964744329453,
      "rmse_dx": 0.005590020678937435,
      "rmse_dy": 0.006458606570959091,
      "rmse_mean": 0.011778531596064568,
      "rotation_flip": 0.005971337668597698,
      "sparse_tokens": 32073.0,
      "step": 7133,
      "turn_loss": 0.0968141183257103,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.33144396952239363,
      "grad_norm": 0.7199509143829346,
      "learning_rate": 3.600220243935505e-06,
      "loss": 0.1457,
      "mae_dtheta": 0.0386333242058754,
      "mae_dx": 0.02198074199259281,
      "mae_dy": 0.009210141375660896,
      "pose_mae_dtheta": 0.30373460054397583,
      "pose_mae_dx": 0.16906459629535675,
      "pose_mae_dy": 0.12926767766475677,
      "pose_rmse_dtheta": 0.5347820520401001,
      "pose_rmse_dx": 0.3153219521045685,
      "pose_rmse_dy": 0.23455260694026947,
      "pose_rmse_mean": 0.3615522086620331,
      "rmse_dtheta": 0.052782654762268066,
      "rmse_dx": 0.03622729331254959,
      "rmse_dy": 0.014061214402318,
      "rmse_mean": 0.03435705602169037,
      "rotation_flip": 0.013698630034923553,
      "sparse_tokens": 3741.0,
      "step": 7134,
      "turn_loss": 0.32035455107688904,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 30400.0,
      "epoch": 0.3314904292882364,
      "grad_norm": 0.5991227030754089,
      "learning_rate": 3.598950945543045e-06,
      "loss": 0.1653,
      "mae_dtheta": 0.035678680986166,
      "mae_dx": 0.01086388248950243,
      "mae_dy": 0.004584106151014566,
      "pose_mae_dtheta": 0.2637071907520294,
      "pose_mae_dx": 0.08478815853595734,
      "pose_mae_dy": 0.05458079278469086,
      "pose_rmse_dtheta": 0.49042269587516785,
      "pose_rmse_dx": 0.19611288607120514,
      "pose_rmse_dy": 0.12779298424720764,
      "pose_rmse_mean": 0.27144286036491394,
      "rmse_dtheta": 0.05546744912862778,
      "rmse_dx": 0.022879190742969513,
      "rmse_dy": 0.008967083878815174,
      "rmse_mean": 0.029104575514793396,
      "rotation_flip": 0.005939124152064323,
      "sparse_tokens": 23617.0,
      "step": 7135,
      "turn_loss": 0.26909154653549194,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3315368890540792,
      "grad_norm": 0.5074481964111328,
      "learning_rate": 3.597681745126696e-06,
      "loss": 0.103,
      "mae_dtheta": 0.012931092642247677,
      "mae_dx": 0.0033125143963843584,
      "mae_dy": 0.0038501466624438763,
      "pose_mae_dtheta": 0.10005777329206467,
      "pose_mae_dx": 0.02663320116698742,
      "pose_mae_dy": 0.033911000937223434,
      "pose_rmse_dtheta": 0.28632932901382446,
      "pose_rmse_dx": 0.07253416627645493,
      "pose_rmse_dy": 0.08137048035860062,
      "pose_rmse_mean": 0.14674466848373413,
      "rmse_dtheta": 0.03126289322972298,
      "rmse_dx": 0.01139724813401699,
      "rmse_dy": 0.00989761296659708,
      "rmse_mean": 0.017519250512123108,
      "rotation_flip": 0.006643219850957394,
      "sparse_tokens": 32105.0,
      "step": 7136,
      "turn_loss": 0.14240415394306183,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.33158334881992196,
      "grad_norm": 0.499698281288147,
      "learning_rate": 3.5964126427752155e-06,
      "loss": 0.1368,
      "mae_dtheta": 0.013705437071621418,
      "mae_dx": 0.0035236773546785116,
      "mae_dy": 0.003914687782526016,
      "pose_mae_dtheta": 0.09581920504570007,
      "pose_mae_dx": 0.04480299353599548,
      "pose_mae_dy": 0.03677450120449066,
      "pose_rmse_dtheta": 0.24682427942752838,
      "pose_rmse_dx": 0.12824983894824982,
      "pose_rmse_dy": 0.0851045697927475,
      "pose_rmse_mean": 0.15339289605617523,
      "rmse_dtheta": 0.0285738967359066,
      "rmse_dx": 0.010323027148842812,
      "rmse_dy": 0.008898759260773659,
      "rmse_mean": 0.01593189500272274,
      "rotation_flip": 0.0049002449959516525,
      "sparse_tokens": 32105.0,
      "step": 7137,
      "turn_loss": 0.13795949518680573,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.33162980858576474,
      "grad_norm": 0.6658048033714294,
      "learning_rate": 3.595143638577352e-06,
      "loss": 0.187,
      "mae_dtheta": 0.008985472843050957,
      "mae_dx": 0.0015658721094951034,
      "mae_dy": 0.00239312625490129,
      "pose_mae_dtheta": 0.06121395155787468,
      "pose_mae_dx": 0.0205882266163826,
      "pose_mae_dy": 0.02759453095495701,
      "pose_rmse_dtheta": 0.14586994051933289,
      "pose_rmse_dx": 0.048468686640262604,
      "pose_rmse_dy": 0.06481911987066269,
      "pose_rmse_mean": 0.08638592064380646,
      "rmse_dtheta": 0.01997440494596958,
      "rmse_dx": 0.004681740887463093,
      "rmse_dy": 0.005745836533606052,
      "rmse_mean": 0.010133994743227959,
      "rotation_flip": 0.003561535384505987,
      "sparse_tokens": 32089.0,
      "step": 7138,
      "turn_loss": 0.08518978953361511,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.3316762683516075,
      "grad_norm": 0.590161919593811,
      "learning_rate": 3.593874732621847e-06,
      "loss": 0.101,
      "mae_dtheta": 0.03417138010263443,
      "mae_dx": 0.012922378256917,
      "mae_dy": 0.00636079628020525,
      "pose_mae_dtheta": 0.2656087577342987,
      "pose_mae_dx": 0.1066848635673523,
      "pose_mae_dy": 0.09169679880142212,
      "pose_rmse_dtheta": 0.4905543923377991,
      "pose_rmse_dx": 0.23344989120960236,
      "pose_rmse_dy": 0.18592947721481323,
      "pose_rmse_mean": 0.3033112585544586,
      "rmse_dtheta": 0.053238220512866974,
      "rmse_dx": 0.02666088007390499,
      "rmse_dy": 0.011633416637778282,
      "rmse_mean": 0.03051084093749523,
      "rotation_flip": 0.015659954398870468,
      "sparse_tokens": 8454.0,
      "step": 7139,
      "turn_loss": 0.2699483633041382,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3317227281174503,
      "grad_norm": 0.4368959963321686,
      "learning_rate": 3.592605924997439e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.01174952182918787,
      "mae_dx": 0.0017234230181202292,
      "mae_dy": 0.0027379135135561228,
      "pose_mae_dtheta": 0.0772290900349617,
      "pose_mae_dx": 0.023252146318554878,
      "pose_mae_dy": 0.03293348848819733,
      "pose_rmse_dtheta": 0.1842469871044159,
      "pose_rmse_dx": 0.06488015502691269,
      "pose_rmse_dy": 0.0820486918091774,
      "pose_rmse_mean": 0.11039194464683533,
      "rmse_dtheta": 0.024470191448926926,
      "rmse_dx": 0.004940092097967863,
      "rmse_dy": 0.006164098624140024,
      "rmse_mean": 0.011858128011226654,
      "rotation_flip": 0.011184755712747574,
      "sparse_tokens": 32105.0,
      "step": 7140,
      "turn_loss": 0.10430151224136353,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.33176918788329307,
      "grad_norm": 0.44343575835227966,
      "learning_rate": 3.5913372157928515e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.011375045403838158,
      "mae_dx": 0.0024031552020460367,
      "mae_dy": 0.0030425810255110264,
      "pose_mae_dtheta": 0.07088860869407654,
      "pose_mae_dx": 0.03145617991685867,
      "pose_mae_dy": 0.03265029564499855,
      "pose_rmse_dtheta": 0.14310787618160248,
      "pose_rmse_dx": 0.08317501097917557,
      "pose_rmse_dy": 0.08191697299480438,
      "pose_rmse_mean": 0.1027332991361618,
      "rmse_dtheta": 0.021969106048345566,
      "rmse_dx": 0.007321695331484079,
      "rmse_dy": 0.007051792461425066,
      "rmse_mean": 0.012114198878407478,
      "rotation_flip": 0.002812939463183284,
      "sparse_tokens": 32137.0,
      "step": 7141,
      "turn_loss": 0.10329025238752365,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.33181564764913585,
      "grad_norm": 0.33414894342422485,
      "learning_rate": 3.5900686050968113e-06,
      "loss": 0.0579,
      "mae_dtheta": 0.037189781665802,
      "mae_dx": 0.00706414645537734,
      "mae_dy": 0.0064384667202830315,
      "pose_mae_dtheta": 0.26242512464523315,
      "pose_mae_dx": 0.051268864423036575,
      "pose_mae_dy": 0.0649060308933258,
      "pose_rmse_dtheta": 0.49201270937919617,
      "pose_rmse_dx": 0.1165044754743576,
      "pose_rmse_dy": 0.13255833089351654,
      "pose_rmse_mean": 0.24702517688274384,
      "rmse_dtheta": 0.05726715549826622,
      "rmse_dx": 0.01723906397819519,
      "rmse_dy": 0.01129577960819006,
      "rmse_mean": 0.028600668534636497,
      "rotation_flip": 0.02711864374577999,
      "sparse_tokens": 4856.0,
      "step": 7142,
      "turn_loss": 0.21535734832286835,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3318621074149786,
      "grad_norm": 0.4296853542327881,
      "learning_rate": 3.588800092998028e-06,
      "loss": 0.0994,
      "mae_dtheta": 0.010051113553345203,
      "mae_dx": 0.0016513274749740958,
      "mae_dy": 0.0022513994481414557,
      "pose_mae_dtheta": 0.06158825382590294,
      "pose_mae_dx": 0.022547604516148567,
      "pose_mae_dy": 0.023629801347851753,
      "pose_rmse_dtheta": 0.14905107021331787,
      "pose_rmse_dx": 0.05301108956336975,
      "pose_rmse_dy": 0.05114341899752617,
      "pose_rmse_mean": 0.08440186083316803,
      "rmse_dtheta": 0.021757176145911217,
      "rmse_dx": 0.004378803540021181,
      "rmse_dy": 0.0047062295489013195,
      "rmse_mean": 0.010280736722052097,
      "rotation_flip": 0.0030674845911562443,
      "sparse_tokens": 32089.0,
      "step": 7143,
      "turn_loss": 0.07645855844020844,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.3319085671808214,
      "grad_norm": 1.291465401649475,
      "learning_rate": 3.587531679585213e-06,
      "loss": 0.3026,
      "mae_dtheta": 0.02489536814391613,
      "mae_dx": 0.008639629930257797,
      "mae_dy": 0.002916153287515044,
      "pose_mae_dtheta": 0.18887348473072052,
      "pose_mae_dx": 0.04640229046344757,
      "pose_mae_dy": 0.04219645634293556,
      "pose_rmse_dtheta": 0.38191959261894226,
      "pose_rmse_dx": 0.12344386428594589,
      "pose_rmse_dy": 0.12707090377807617,
      "pose_rmse_mean": 0.21081146597862244,
      "rmse_dtheta": 0.04629172012209892,
      "rmse_dx": 0.019903365522623062,
      "rmse_dy": 0.006186086218804121,
      "rmse_mean": 0.024127056822180748,
      "rotation_flip": 0.011904762126505375,
      "sparse_tokens": 2658.0,
      "step": 7144,
      "turn_loss": 0.17601031064987183,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3319550269466642,
      "grad_norm": 0.4503389000892639,
      "learning_rate": 3.5862633649470645e-06,
      "loss": 0.1011,
      "mae_dtheta": 0.006946653593331575,
      "mae_dx": 0.0011342877987772226,
      "mae_dy": 0.0016629426972940564,
      "pose_mae_dtheta": 0.04522044584155083,
      "pose_mae_dx": 0.015416545793414116,
      "pose_mae_dy": 0.021054761484265327,
      "pose_rmse_dtheta": 0.08119942992925644,
      "pose_rmse_dx": 0.03867868706583977,
      "pose_rmse_dy": 0.04605039209127426,
      "pose_rmse_mean": 0.05530950427055359,
      "rmse_dtheta": 0.013855475932359695,
      "rmse_dx": 0.0033451104536652565,
      "rmse_dy": 0.0033573266118764877,
      "rmse_mean": 0.0068526375107467175,
      "rotation_flip": 0.0016064257360994816,
      "sparse_tokens": 32089.0,
      "step": 7145,
      "turn_loss": 0.057996273040771484,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.33200148671250695,
      "grad_norm": 0.5680277347564697,
      "learning_rate": 3.5849951491722777e-06,
      "loss": 0.1364,
      "mae_dtheta": 0.0369572676718235,
      "mae_dx": 0.010306982323527336,
      "mae_dy": 0.005889127962291241,
      "pose_mae_dtheta": 0.3140946328639984,
      "pose_mae_dx": 0.0818687230348587,
      "pose_mae_dy": 0.06342573463916779,
      "pose_rmse_dtheta": 0.5466383099555969,
      "pose_rmse_dx": 0.1913226991891861,
      "pose_rmse_dy": 0.1468311846256256,
      "pose_rmse_mean": 0.29493075609207153,
      "rmse_dtheta": 0.05753692239522934,
      "rmse_dx": 0.022099675610661507,
      "rmse_dy": 0.013169965706765652,
      "rmse_mean": 0.03093552216887474,
      "rotation_flip": 0.007342143915593624,
      "sparse_tokens": 10368.0,
      "step": 7146,
      "turn_loss": 0.32037198543548584,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.33204794647834973,
      "grad_norm": 0.45490261912345886,
      "learning_rate": 3.5837270323495416e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.012982950545847416,
      "mae_dx": 0.001978919841349125,
      "mae_dy": 0.0027214097790420055,
      "pose_mae_dtheta": 0.08924764394760132,
      "pose_mae_dx": 0.027968328446149826,
      "pose_mae_dy": 0.0265364833176136,
      "pose_rmse_dtheta": 0.24495239555835724,
      "pose_rmse_dx": 0.07629258185625076,
      "pose_rmse_dy": 0.0678868219256401,
      "pose_rmse_mean": 0.1297106146812439,
      "rmse_dtheta": 0.03074841946363449,
      "rmse_dx": 0.0046407007612288,
      "rmse_dy": 0.007215423975139856,
      "rmse_mean": 0.014201516285538673,
      "rotation_flip": 0.006520905066281557,
      "sparse_tokens": 32169.0,
      "step": 7147,
      "turn_loss": 0.0959613025188446,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3320944062441925,
      "grad_norm": 0.4169315695762634,
      "learning_rate": 3.582459014567532e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.00778735289350152,
      "mae_dx": 0.0009767701849341393,
      "mae_dy": 0.0010448511457070708,
      "pose_mae_dtheta": 0.05785572528839111,
      "pose_mae_dx": 0.012079055421054363,
      "pose_mae_dy": 0.01748034916818142,
      "pose_rmse_dtheta": 0.19073668122291565,
      "pose_rmse_dx": 0.031147299334406853,
      "pose_rmse_dy": 0.04321139678359032,
      "pose_rmse_mean": 0.08836513012647629,
      "rmse_dtheta": 0.021133536472916603,
      "rmse_dx": 0.0032254813704639673,
      "rmse_dy": 0.002187749370932579,
      "rmse_mean": 0.008848922327160835,
      "rotation_flip": 0.0008877053041942418,
      "sparse_tokens": 32089.0,
      "step": 7148,
      "turn_loss": 0.05353740230202675,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3321408660100353,
      "grad_norm": 0.5001536011695862,
      "learning_rate": 3.5811910959149266e-06,
      "loss": 0.1452,
      "mae_dtheta": 0.01100919023156166,
      "mae_dx": 0.0022166166454553604,
      "mae_dy": 0.003883841447532177,
      "pose_mae_dtheta": 0.06900984048843384,
      "pose_mae_dx": 0.03231804817914963,
      "pose_mae_dy": 0.03551207855343819,
      "pose_rmse_dtheta": 0.15308037400245667,
      "pose_rmse_dx": 0.09814994782209396,
      "pose_rmse_dy": 0.08347859233617783,
      "pose_rmse_mean": 0.11156964302062988,
      "rmse_dtheta": 0.023227930068969727,
      "rmse_dx": 0.006020902656018734,
      "rmse_dy": 0.008326004259288311,
      "rmse_mean": 0.012524946592748165,
      "rotation_flip": 0.006331471260637045,
      "sparse_tokens": 32105.0,
      "step": 7149,
      "turn_loss": 0.09967547655105591,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3321873257758781,
      "grad_norm": 0.6441087126731873,
      "learning_rate": 3.579923276480387e-06,
      "loss": 0.1333,
      "mae_dtheta": 0.011891198344528675,
      "mae_dx": 0.003058731323108077,
      "mae_dy": 0.003611984895542264,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.644108772277832,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 169.05718994140625,
      "model/head/act_norm_mean": 108.66187263257575,
      "model/head/act_norm_min": 47.29814910888672,
      "model/head/act_over_embed": 74.67345618158559,
      "model/head/grad_frac": 0.09751991182565689,
      "model/head/grad_norm": 0.06281343102455139,
      "model/head/grad_zero_frac": 0.00016688494361005723,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.70394866635101,
      "model/head/update_ratio": 0.001071140286512673,
      "model/head/weight_delta": 9.437413215637207,
      "model/head/weight_delta_rel": 0.16556018590927124,
      "model/head/weight_norm": 58.64164733886719,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4219411611557007,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42186681825111355,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4218168258666992,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28991082708154436,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10556648671627045,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0679963007569313,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5391862273755657,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002196397865191102,
      "model/modality_embedder.encoders.pose/weight_delta": 3.03344464302063,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09911209344863892,
      "model/modality_embedder.encoders.pose/weight_norm": 30.958099365234375,
      "model/modality_embedder/grad_frac": 0.10556648671627045,
      "model/modality_embedder/grad_norm": 0.0679963007569313,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5391862273755657,
      "model/modality_embedder/update_ratio": 0.002196397865191102,
      "model/modality_embedder/weight_delta": 3.03344464302063,
      "model/modality_embedder/weight_delta_rel": 0.09911209344863892,
      "model/modality_embedder/weight_norm": 30.958099365234375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.61438751220703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.568504990379992,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.13412094116211,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.196497281209275,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.061508215963840485,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.039617981761693954,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014197744894772768,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4826853275299072,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09047055244445801,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.9044189453125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.93551635742188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.546108405483405,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.498002052307129,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.868315500535715,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0647449791431427,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04170281067490578,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014051904436200857,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1489598751068115,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10908243060112,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.677692413330078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.1124496459961,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.445110830527497,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.373246192932129,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.173327745766827,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0671374574303627,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04324382543563843,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014112333301454782,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.3994574546813965,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11414741724729538,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.642576217651367,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.45841217041016,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.269297639089306,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.522990226745605,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.426925998916474,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0729636400938034,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.046996522694826126,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001572884852066636,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.9089999198913574,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09941580891609192,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.879188537597656,
      "model/normalizer/grad_frac": 0.27997320890426636,
      "model/normalizer/grad_norm": 0.1803331971168518,
      "model/normalizer/grad_zero_frac": 0.00021862160065211356,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0022956745233386755,
      "model/normalizer/weight_delta": 6.1480278968811035,
      "model/normalizer/weight_delta_rel": 0.07918304204940796,
      "model/normalizer/weight_norm": 78.553466796875,
      "pose_mae_dtheta": 0.07990176975727081,
      "pose_mae_dx": 0.034871138632297516,
      "pose_mae_dy": 0.03234022110700607,
      "pose_rmse_dtheta": 0.2132664918899536,
      "pose_rmse_dx": 0.10453616082668304,
      "pose_rmse_dy": 0.07786565274000168,
      "pose_rmse_mean": 0.1318894475698471,
      "rmse_dtheta": 0.02641952969133854,
      "rmse_dx": 0.009326971136033535,
      "rmse_dy": 0.008446917869150639,
      "rmse_mean": 0.014731138944625854,
      "rotation_flip": 0.009296685457229614,
      "sparse_tokens": 32089.0,
      "step": 7150,
      "turn_loss": 0.10859508067369461,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.3322337855417209,
      "grad_norm": 0.5389150977134705,
      "learning_rate": 3.5786555563525748e-06,
      "loss": 0.0888,
      "mae_dtheta": 0.00862177088856697,
      "mae_dx": 0.0012175716692581773,
      "mae_dy": 0.00024114579719025642,
      "pose_mae_dtheta": 0.06344868242740631,
      "pose_mae_dx": 0.009775472804903984,
      "pose_mae_dy": 0.0034065560903400183,
      "pose_rmse_dtheta": 0.2864154875278473,
      "pose_rmse_dx": 0.02276771329343319,
      "pose_rmse_dy": 0.007224984001368284,
      "pose_rmse_mean": 0.10546939820051193,
      "rmse_dtheta": 0.03262434899806976,
      "rmse_dx": 0.003616061294451356,
      "rmse_dy": 0.000491785875055939,
      "rmse_mean": 0.012244066223502159,
      "rotation_flip": 0.0029922202229499817,
      "sparse_tokens": 32217.0,
      "step": 7151,
      "turn_loss": 0.03837119787931442,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.33228024530756367,
      "grad_norm": 0.4228581190109253,
      "learning_rate": 3.5773879356201452e-06,
      "loss": 0.1187,
      "mae_dtheta": 0.01392325758934021,
      "mae_dx": 0.002106128493323922,
      "mae_dy": 0.004010174889117479,
      "pose_mae_dtheta": 0.09255984425544739,
      "pose_mae_dx": 0.03228258341550827,
      "pose_mae_dy": 0.04335533082485199,
      "pose_rmse_dtheta": 0.17131617665290833,
      "pose_rmse_dx": 0.0925627276301384,
      "pose_rmse_dy": 0.09173137694597244,
      "pose_rmse_mean": 0.11853676289319992,
      "rmse_dtheta": 0.023093033581972122,
      "rmse_dx": 0.006400937680155039,
      "rmse_dy": 0.007865570485591888,
      "rmse_mean": 0.01245318166911602,
      "rotation_flip": 0.0062715583480894566,
      "sparse_tokens": 32073.0,
      "step": 7152,
      "turn_loss": 0.11115596443414688,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4253.0,
      "epoch": 0.33232670507340645,
      "grad_norm": 0.7313030362129211,
      "learning_rate": 3.5761204143717387e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.020738201215863228,
      "mae_dx": 0.008678143844008446,
      "mae_dy": 0.005766950082033873,
      "pose_mae_dtheta": 0.1407446414232254,
      "pose_mae_dx": 0.053265057504177094,
      "pose_mae_dy": 0.06835749000310898,
      "pose_rmse_dtheta": 0.2513843774795532,
      "pose_rmse_dx": 0.12930481135845184,
      "pose_rmse_dy": 0.13954252004623413,
      "pose_rmse_mean": 0.1734105795621872,
      "rmse_dtheta": 0.0343666709959507,
      "rmse_dx": 0.0203294325619936,
      "rmse_dy": 0.012256893329322338,
      "rmse_mean": 0.022317666560411453,
      "rotation_flip": 0.008620689623057842,
      "sparse_tokens": 3589.0,
      "step": 7153,
      "turn_loss": 0.27361956238746643,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3323731648392492,
      "grad_norm": 0.4879894256591797,
      "learning_rate": 3.5748529926959972e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.007758713327348232,
      "mae_dx": 0.002021660329774022,
      "mae_dy": 0.0019002837361767888,
      "pose_mae_dtheta": 0.05743582546710968,
      "pose_mae_dx": 0.015067528933286667,
      "pose_mae_dy": 0.01620122231543064,
      "pose_rmse_dtheta": 0.18996213376522064,
      "pose_rmse_dx": 0.045124683529138565,
      "pose_rmse_dy": 0.04093179851770401,
      "pose_rmse_mean": 0.09200620651245117,
      "rmse_dtheta": 0.02189159393310547,
      "rmse_dx": 0.007699399255216122,
      "rmse_dy": 0.0065681831911206245,
      "rmse_mean": 0.012053059414029121,
      "rotation_flip": 0.0038953812327235937,
      "sparse_tokens": 32073.0,
      "step": 7154,
      "turn_loss": 0.0785355493426323,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.332419624605092,
      "grad_norm": 0.5971344709396362,
      "learning_rate": 3.57358567068155e-06,
      "loss": 0.0961,
      "mae_dtheta": 0.007195687852799892,
      "mae_dx": 0.0017774958396330476,
      "mae_dy": 0.0013956297188997269,
      "pose_mae_dtheta": 0.05238443985581398,
      "pose_mae_dx": 0.01770154945552349,
      "pose_mae_dy": 0.015340398997068405,
      "pose_rmse_dtheta": 0.16685330867767334,
      "pose_rmse_dx": 0.03933526948094368,
      "pose_rmse_dy": 0.04345687851309776,
      "pose_rmse_mean": 0.0832151547074318,
      "rmse_dtheta": 0.020425325259566307,
      "rmse_dx": 0.004577402491122484,
      "rmse_dy": 0.0035425617825239897,
      "rmse_mean": 0.009515096433460712,
      "rotation_flip": 0.0020703934133052826,
      "sparse_tokens": 32233.0,
      "step": 7155,
      "turn_loss": 0.062295738607645035,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.3324660843709348,
      "grad_norm": 0.624965250492096,
      "learning_rate": 3.572318448417023e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.040496405214071274,
      "mae_dx": 0.008939458057284355,
      "mae_dy": 0.004010838456451893,
      "pose_mae_dtheta": 0.32091572880744934,
      "pose_mae_dx": 0.08158954977989197,
      "pose_mae_dy": 0.059553295373916626,
      "pose_rmse_dtheta": 0.5361821055412292,
      "pose_rmse_dx": 0.1746361404657364,
      "pose_rmse_dy": 0.16330385208129883,
      "pose_rmse_mean": 0.2913740277290344,
      "rmse_dtheta": 0.0560193732380867,
      "rmse_dx": 0.02046479843556881,
      "rmse_dy": 0.011420234106481075,
      "rmse_mean": 0.029301470145583153,
      "rotation_flip": 0.00671140942722559,
      "sparse_tokens": 4549.0,
      "step": 7156,
      "turn_loss": 0.3105512857437134,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.33251254413677755,
      "grad_norm": 0.39025259017944336,
      "learning_rate": 3.5710513259910327e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.03245145082473755,
      "mae_dx": 0.01168254017829895,
      "mae_dy": 0.0061861686408519745,
      "pose_mae_dtheta": 0.24885687232017517,
      "pose_mae_dx": 0.07652056962251663,
      "pose_mae_dy": 0.06928068399429321,
      "pose_rmse_dtheta": 0.4186455011367798,
      "pose_rmse_dx": 0.13769686222076416,
      "pose_rmse_dy": 0.15344855189323425,
      "pose_rmse_mean": 0.2365969866514206,
      "rmse_dtheta": 0.045319292694330215,
      "rmse_dx": 0.021922310814261436,
      "rmse_dy": 0.012441825121641159,
      "rmse_mean": 0.02656114101409912,
      "rotation_flip": 0.005847953259944916,
      "sparse_tokens": 5737.0,
      "step": 7157,
      "turn_loss": 0.2566053867340088,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 5871.0,
      "epoch": 0.33255900390262033,
      "grad_norm": 0.510362446308136,
      "learning_rate": 3.5697843034921897e-06,
      "loss": 0.0756,
      "mae_dtheta": 0.026792436838150024,
      "mae_dx": 0.009488413110375404,
      "mae_dy": 0.0029002896044403315,
      "pose_mae_dtheta": 0.17883464694023132,
      "pose_mae_dx": 0.056666869670152664,
      "pose_mae_dy": 0.033420007675886154,
      "pose_rmse_dtheta": 0.32670438289642334,
      "pose_rmse_dx": 0.14888346195220947,
      "pose_rmse_dy": 0.08872974663972855,
      "pose_rmse_mean": 0.18810586631298065,
      "rmse_dtheta": 0.04457275941967964,
      "rmse_dx": 0.02122725360095501,
      "rmse_dy": 0.00557387201115489,
      "rmse_mean": 0.023791294544935226,
      "rotation_flip": 0.02181818149983883,
      "sparse_tokens": 5184.0,
      "step": 7158,
      "turn_loss": 0.16555750370025635,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3326054636684631,
      "grad_norm": 0.6744146943092346,
      "learning_rate": 3.568517381009099e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.009200112894177437,
      "mae_dx": 0.0010919185588136315,
      "mae_dy": 0.0006566742085851729,
      "pose_mae_dtheta": 0.07223384827375412,
      "pose_mae_dx": 0.009783869609236717,
      "pose_mae_dy": 0.007383448071777821,
      "pose_rmse_dtheta": 0.29782477021217346,
      "pose_rmse_dx": 0.02613493800163269,
      "pose_rmse_dy": 0.027640946209430695,
      "pose_rmse_mean": 0.11720021814107895,
      "rmse_dtheta": 0.03191130608320236,
      "rmse_dx": 0.0030033038929104805,
      "rmse_dy": 0.002198917558416724,
      "rmse_mean": 0.012371174991130829,
      "rotation_flip": 0.0016987542621791363,
      "sparse_tokens": 32201.0,
      "step": 7159,
      "turn_loss": 0.05034487694501877,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3326519234343059,
      "grad_norm": 0.810269832611084,
      "learning_rate": 3.5672505586303553e-06,
      "loss": 0.1908,
      "mae_dtheta": 0.00953104067593813,
      "mae_dx": 0.0014473865740001202,
      "mae_dy": 0.002095953794196248,
      "pose_mae_dtheta": 0.06178917735815048,
      "pose_mae_dx": 0.02026916667819023,
      "pose_mae_dy": 0.02387198619544506,
      "pose_rmse_dtheta": 0.157933309674263,
      "pose_rmse_dx": 0.05879736319184303,
      "pose_rmse_dy": 0.05549087002873421,
      "pose_rmse_mean": 0.09074051678180695,
      "rmse_dtheta": 0.02051028423011303,
      "rmse_dx": 0.004655499942600727,
      "rmse_dy": 0.004966826643794775,
      "rmse_mean": 0.010044204071164131,
      "rotation_flip": 0.004044943954795599,
      "sparse_tokens": 32057.0,
      "step": 7160,
      "turn_loss": 0.07018700242042542,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.33269838320014866,
      "grad_norm": 0.7396318912506104,
      "learning_rate": 3.5659838364445505e-06,
      "loss": 0.1617,
      "mae_dtheta": 0.010822877287864685,
      "mae_dx": 0.0013867150992155075,
      "mae_dy": 0.0024615046568214893,
      "pose_mae_dtheta": 0.07208897173404694,
      "pose_mae_dx": 0.021724428981542587,
      "pose_mae_dy": 0.030548017472028732,
      "pose_rmse_dtheta": 0.18877345323562622,
      "pose_rmse_dx": 0.06314919888973236,
      "pose_rmse_dy": 0.09388243407011032,
      "pose_rmse_mean": 0.11526837199926376,
      "rmse_dtheta": 0.023298924788832664,
      "rmse_dx": 0.004509675782173872,
      "rmse_dy": 0.005603439174592495,
      "rmse_mean": 0.011137346737086773,
      "rotation_flip": 0.005628517828881741,
      "sparse_tokens": 32073.0,
      "step": 7161,
      "turn_loss": 0.08146623522043228,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.33274484296599144,
      "grad_norm": 0.4660733938217163,
      "learning_rate": 3.564717214540263e-06,
      "loss": 0.0957,
      "mae_dtheta": 0.018889842554926872,
      "mae_dx": 0.003621872281655669,
      "mae_dy": 0.003901881165802479,
      "pose_mae_dtheta": 0.14474689960479736,
      "pose_mae_dx": 0.040918540209531784,
      "pose_mae_dy": 0.03881566971540451,
      "pose_rmse_dtheta": 0.368865430355072,
      "pose_rmse_dx": 0.1152513399720192,
      "pose_rmse_dy": 0.10581949353218079,
      "pose_rmse_mean": 0.19664542376995087,
      "rmse_dtheta": 0.03995468094944954,
      "rmse_dx": 0.009563480503857136,
      "rmse_dy": 0.009771293960511684,
      "rmse_mean": 0.019763153046369553,
      "rotation_flip": 0.011812477372586727,
      "sparse_tokens": 32153.0,
      "step": 7162,
      "turn_loss": 0.15427100658416748,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.3327913027318342,
      "grad_norm": 0.6094393134117126,
      "learning_rate": 3.563450693006074e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.02211364172399044,
      "mae_dx": 0.010123580694198608,
      "mae_dy": 0.0027932829689234495,
      "pose_mae_dtheta": 0.15227088332176208,
      "pose_mae_dx": 0.07265077531337738,
      "pose_mae_dy": 0.023446455597877502,
      "pose_rmse_dtheta": 0.2950589060783386,
      "pose_rmse_dx": 0.17041057348251343,
      "pose_rmse_dy": 0.0631076991558075,
      "pose_rmse_mean": 0.17619240283966064,
      "rmse_dtheta": 0.03756267949938774,
      "rmse_dx": 0.02246343530714512,
      "rmse_dy": 0.00623508682474494,
      "rmse_mean": 0.022087067365646362,
      "rotation_flip": 0.004048583097755909,
      "sparse_tokens": 5038.0,
      "step": 7163,
      "turn_loss": 0.16603736579418182,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.332837762497677,
      "grad_norm": 0.6571527719497681,
      "learning_rate": 3.5621842719305468e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.007189151365309954,
      "mae_dx": 0.0019494171719998121,
      "mae_dy": 0.0011530499905347824,
      "pose_mae_dtheta": 0.050882767885923386,
      "pose_mae_dx": 0.01822981983423233,
      "pose_mae_dy": 0.013014308176934719,
      "pose_rmse_dtheta": 0.17845985293388367,
      "pose_rmse_dx": 0.04082545265555382,
      "pose_rmse_dy": 0.03419056907296181,
      "pose_rmse_mean": 0.08449196070432663,
      "rmse_dtheta": 0.022643985226750374,
      "rmse_dx": 0.005383836105465889,
      "rmse_dy": 0.002887839451432228,
      "rmse_mean": 0.010305220261216164,
      "rotation_flip": 0.0016085790703073144,
      "sparse_tokens": 32153.0,
      "step": 7164,
      "turn_loss": 0.06252916157245636,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.33288422226351977,
      "grad_norm": 0.7583435773849487,
      "learning_rate": 3.560917951402245e-06,
      "loss": 0.1912,
      "mae_dtheta": 0.035231031477451324,
      "mae_dx": 0.010229513049125671,
      "mae_dy": 0.006663565989583731,
      "pose_mae_dtheta": 0.2993198335170746,
      "pose_mae_dx": 0.09290312975645065,
      "pose_mae_dy": 0.08691159635782242,
      "pose_rmse_dtheta": 0.5331006646156311,
      "pose_rmse_dx": 0.2023795247077942,
      "pose_rmse_dy": 0.19364440441131592,
      "pose_rmse_mean": 0.30970820784568787,
      "rmse_dtheta": 0.05446440353989601,
      "rmse_dx": 0.02172114886343479,
      "rmse_dy": 0.014842874370515347,
      "rmse_mean": 0.030342809855937958,
      "rotation_flip": 0.01319875754415989,
      "sparse_tokens": 21057.0,
      "step": 7165,
      "turn_loss": 0.30950284004211426,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.33293068202936255,
      "grad_norm": 0.49611660838127136,
      "learning_rate": 3.5596517315097257e-06,
      "loss": 0.1232,
      "mae_dtheta": 0.007412484847009182,
      "mae_dx": 0.001116632018238306,
      "mae_dy": 0.0008291153935715556,
      "pose_mae_dtheta": 0.05159588158130646,
      "pose_mae_dx": 0.009231791831552982,
      "pose_mae_dy": 0.010387565940618515,
      "pose_rmse_dtheta": 0.19223812222480774,
      "pose_rmse_dx": 0.020477762445807457,
      "pose_rmse_dy": 0.02638826332986355,
      "pose_rmse_mean": 0.07970137894153595,
      "rmse_dtheta": 0.0235627181828022,
      "rmse_dx": 0.0030193221755325794,
      "rmse_dy": 0.0020760369952768087,
      "rmse_mean": 0.009552692994475365,
      "rotation_flip": 0.001439539366401732,
      "sparse_tokens": 32169.0,
      "step": 7166,
      "turn_loss": 0.04583185538649559,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.3329771417952054,
      "grad_norm": 0.5109667778015137,
      "learning_rate": 3.5583856123415317e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.03829960897564888,
      "mae_dx": 0.007402330171316862,
      "mae_dy": 0.004751517437398434,
      "pose_mae_dtheta": 0.3199410140514374,
      "pose_mae_dx": 0.06636212021112442,
      "pose_mae_dy": 0.05078504607081413,
      "pose_rmse_dtheta": 0.5230699181556702,
      "pose_rmse_dx": 0.16257746517658234,
      "pose_rmse_dy": 0.11426520347595215,
      "pose_rmse_mean": 0.26663753390312195,
      "rmse_dtheta": 0.05448167398571968,
      "rmse_dx": 0.01681157946586609,
      "rmse_dy": 0.009599397890269756,
      "rmse_mean": 0.02696421556174755,
      "rotation_flip": 0.016152717173099518,
      "sparse_tokens": 11964.0,
      "step": 7167,
      "turn_loss": 0.2807091474533081,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 25556.0,
      "epoch": 0.33302360156104815,
      "grad_norm": 0.41470256447792053,
      "learning_rate": 3.557119593986208e-06,
      "loss": 0.1535,
      "mae_dtheta": 0.03597675636410713,
      "mae_dx": 0.013184414245188236,
      "mae_dy": 0.005779284983873367,
      "pose_mae_dtheta": 0.3019145429134369,
      "pose_mae_dx": 0.10292608290910721,
      "pose_mae_dy": 0.06875189393758774,
      "pose_rmse_dtheta": 0.5057711005210876,
      "pose_rmse_dx": 0.20932817459106445,
      "pose_rmse_dy": 0.17254552245140076,
      "pose_rmse_mean": 0.29588159918785095,
      "rmse_dtheta": 0.05264562368392944,
      "rmse_dx": 0.024638047441840172,
      "rmse_dy": 0.011872828006744385,
      "rmse_mean": 0.029718834906816483,
      "rotation_flip": 0.01303214579820633,
      "sparse_tokens": 19578.0,
      "step": 7168,
      "turn_loss": 0.23999395966529846,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.33307006132689093,
      "grad_norm": 0.42608878016471863,
      "learning_rate": 3.5558536765322825e-06,
      "loss": 0.1114,
      "mae_dtheta": 0.012193636037409306,
      "mae_dx": 0.0019495240412652493,
      "mae_dy": 0.00264295213855803,
      "pose_mae_dtheta": 0.07913577556610107,
      "pose_mae_dx": 0.023688536137342453,
      "pose_mae_dy": 0.028699126094579697,
      "pose_rmse_dtheta": 0.18517601490020752,
      "pose_rmse_dx": 0.05597233772277832,
      "pose_rmse_dy": 0.06039183586835861,
      "pose_rmse_mean": 0.10051339864730835,
      "rmse_dtheta": 0.025259990245103836,
      "rmse_dx": 0.005473748315125704,
      "rmse_dy": 0.006281760521233082,
      "rmse_mean": 0.012338499538600445,
      "rotation_flip": 0.0042105261236429214,
      "sparse_tokens": 32089.0,
      "step": 7169,
      "turn_loss": 0.1090010404586792,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.3331165210927337,
      "grad_norm": 0.4371059238910675,
      "learning_rate": 3.5545878600682855e-06,
      "loss": 0.0863,
      "mae_dtheta": 0.03979929909110069,
      "mae_dx": 0.012628084979951382,
      "mae_dy": 0.007311811670660973,
      "pose_mae_dtheta": 0.33072027564048767,
      "pose_mae_dx": 0.10529514402151108,
      "pose_mae_dy": 0.08791907876729965,
      "pose_rmse_dtheta": 0.5143856406211853,
      "pose_rmse_dx": 0.21052707731723785,
      "pose_rmse_dy": 0.2025781124830246,
      "pose_rmse_mean": 0.3091636300086975,
      "rmse_dtheta": 0.054810184985399246,
      "rmse_dx": 0.023269375786185265,
      "rmse_dy": 0.01455622911453247,
      "rmse_mean": 0.030878596007823944,
      "rotation_flip": 0.008628955110907555,
      "sparse_tokens": 18512.0,
      "step": 7170,
      "turn_loss": 0.33212709426879883,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 38938.0,
      "epoch": 0.3331629808585765,
      "grad_norm": 0.7318898439407349,
      "learning_rate": 3.553322144682737e-06,
      "loss": 0.152,
      "mae_dtheta": 0.02695046365261078,
      "mae_dx": 0.010751048102974892,
      "mae_dy": 0.006875519175082445,
      "pose_mae_dtheta": 0.19851364195346832,
      "pose_mae_dx": 0.09200408309698105,
      "pose_mae_dy": 0.06417712569236755,
      "pose_rmse_dtheta": 0.3991507589817047,
      "pose_rmse_dx": 0.21446624398231506,
      "pose_rmse_dy": 0.18132303655147552,
      "pose_rmse_mean": 0.2649800181388855,
      "rmse_dtheta": 0.04624613747000694,
      "rmse_dx": 0.022411467507481575,
      "rmse_dy": 0.016719074919819832,
      "rmse_mean": 0.028458893299102783,
      "rotation_flip": 0.012010113336145878,
      "sparse_tokens": 29904.0,
      "step": 7171,
      "turn_loss": 0.25517570972442627,
      "turns": 120.0,
      "turns_per_sample": 120.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.33320944062441926,
      "grad_norm": 0.4405740797519684,
      "learning_rate": 3.5520565304641464e-06,
      "loss": 0.0843,
      "mae_dtheta": 0.010000713169574738,
      "mae_dx": 0.001501426100730896,
      "mae_dy": 0.0015281162923201919,
      "pose_mae_dtheta": 0.07091179490089417,
      "pose_mae_dx": 0.0176294706761837,
      "pose_mae_dy": 0.021126767620444298,
      "pose_rmse_dtheta": 0.2077593356370926,
      "pose_rmse_dx": 0.04261540621519089,
      "pose_rmse_dy": 0.05138557404279709,
      "pose_rmse_mean": 0.10058677196502686,
      "rmse_dtheta": 0.02465631626546383,
      "rmse_dx": 0.0046419985592365265,
      "rmse_dy": 0.003228588029742241,
      "rmse_mean": 0.010842300951480865,
      "rotation_flip": 0.006748207379132509,
      "sparse_tokens": 32137.0,
      "step": 7172,
      "turn_loss": 0.06978989392518997,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.33325590039026204,
      "grad_norm": 0.5451129674911499,
      "learning_rate": 3.5507910175010194e-06,
      "loss": 0.2007,
      "mae_dtheta": 0.03399268537759781,
      "mae_dx": 0.016372807323932648,
      "mae_dy": 0.008219669573009014,
      "pose_mae_dtheta": 0.28607261180877686,
      "pose_mae_dx": 0.14529915153980255,
      "pose_mae_dy": 0.1046472042798996,
      "pose_rmse_dtheta": 0.4758330285549164,
      "pose_rmse_dx": 0.27592483162879944,
      "pose_rmse_dy": 0.20659925043582916,
      "pose_rmse_mean": 0.3194523751735687,
      "rmse_dtheta": 0.05116374418139458,
      "rmse_dx": 0.028836220502853394,
      "rmse_dy": 0.01453428715467453,
      "rmse_mean": 0.031511418521404266,
      "rotation_flip": 0.020276498049497604,
      "sparse_tokens": 19978.0,
      "step": 7173,
      "turn_loss": 0.3229519724845886,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3333023601561048,
      "grad_norm": 0.294541597366333,
      "learning_rate": 3.5495256058818546e-06,
      "loss": 0.0601,
      "mae_dtheta": 0.009910407476127148,
      "mae_dx": 0.0015268073184415698,
      "mae_dy": 0.0005907242302782834,
      "pose_mae_dtheta": 0.07322466373443604,
      "pose_mae_dx": 0.01264589000493288,
      "pose_mae_dy": 0.00912531279027462,
      "pose_rmse_dtheta": 0.2722867727279663,
      "pose_rmse_dx": 0.03303021937608719,
      "pose_rmse_dy": 0.030194858089089394,
      "pose_rmse_mean": 0.11183728277683258,
      "rmse_dtheta": 0.031797006726264954,
      "rmse_dx": 0.0048407940194010735,
      "rmse_dy": 0.001491530449129641,
      "rmse_mean": 0.012709777802228928,
      "rotation_flip": 0.004240282811224461,
      "sparse_tokens": 32121.0,
      "step": 7174,
      "turn_loss": 0.05824632942676544,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.3333488199219476,
      "grad_norm": 0.4949183166027069,
      "learning_rate": 3.548260295695143e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.02868734672665596,
      "mae_dx": 0.013497446663677692,
      "mae_dy": 0.002875827020034194,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.49491846561431885,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.86106872558594,
      "model/head/act_norm_mean": 101.2243121603261,
      "model/head/act_norm_min": 73.9474105834961,
      "model/head/act_over_embed": 69.56229499351743,
      "model/head/grad_frac": 0.10798969119787216,
      "model/head/grad_norm": 0.05344609171152115,
      "model/head/grad_zero_frac": 0.0001440413761883974,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.692000679347826,
      "model/head/update_ratio": 0.0009113758569583297,
      "model/head/weight_delta": 9.446885108947754,
      "model/head/weight_delta_rel": 0.16572634875774384,
      "model/head/weight_norm": 58.64330291748047,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4218701124191284,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42182425657908124,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42178812623023987,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2898815783020551,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08655773848295212,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04283902421593666,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5477701822916666,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013837573351338506,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0367302894592285,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0992194414138794,
      "model/modality_embedder.encoders.pose/weight_norm": 30.958480834960938,
      "model/modality_embedder/grad_frac": 0.08655773848295212,
      "model/modality_embedder/grad_norm": 0.04283902421593666,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5477701822916666,
      "model/modality_embedder/update_ratio": 0.0013837573351338506,
      "model/modality_embedder/weight_delta": 3.0367302894592285,
      "model/modality_embedder/weight_delta_rel": 0.0992194414138794,
      "model/modality_embedder/weight_norm": 30.958480834960938,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.36543273925781,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.83019808919945,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.113687515258789,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.689125866579896,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06435036659240723,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03184818476438522,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001141321030445397,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4863686561584473,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09060477465391159,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.9046688079834,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.861328125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.642506685645273,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.838523864746094,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.247351939010365,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06220611184835434,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03078695386648178,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001037346781231463,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.153667688369751,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10924551635980606,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.67855453491211,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.57289123535156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.216455853174605,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.1806001663208,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.32898454248079,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06685195118188858,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03308626636862755,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010797028662636876,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.404438018798828,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11431465297937393,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.643861770629883,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.33816528320312,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.069541494133887,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.21558666229248,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.602442343809116,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0655025914311409,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03241844102740288,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010849451646208763,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.9133951663970947,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.0995660200715065,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.880258560180664,
      "model/normalizer/grad_frac": 0.22777262330055237,
      "model/normalizer/grad_norm": 0.11272887885570526,
      "model/normalizer/grad_zero_frac": 0.0001855329319369048,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014350394485518336,
      "model/normalizer/weight_delta": 6.157139778137207,
      "model/normalizer/weight_delta_rel": 0.0793003961443901,
      "model/normalizer/weight_norm": 78.55455017089844,
      "pose_mae_dtheta": 0.23428520560264587,
      "pose_mae_dx": 0.10067090392112732,
      "pose_mae_dy": 0.0316234715282917,
      "pose_rmse_dtheta": 0.4446571171283722,
      "pose_rmse_dx": 0.21428966522216797,
      "pose_rmse_dy": 0.07849112898111343,
      "pose_rmse_mean": 0.24581263959407806,
      "rmse_dtheta": 0.0460965670645237,
      "rmse_dx": 0.025456462055444717,
      "rmse_dy": 0.006062419153749943,
      "rmse_mean": 0.025871817022562027,
      "rotation_flip": 0.005780346691608429,
      "sparse_tokens": 5427.0,
      "step": 7175,
      "turn_loss": 0.22201065719127655,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.33339527968779037,
      "grad_norm": 0.6727996468544006,
      "learning_rate": 3.546995087029368e-06,
      "loss": 0.1945,
      "mae_dtheta": 0.03691922500729561,
      "mae_dx": 0.007710322272032499,
      "mae_dy": 0.0035244564060121775,
      "pose_mae_dtheta": 0.2420642077922821,
      "pose_mae_dx": 0.06093594804406166,
      "pose_mae_dy": 0.019727839156985283,
      "pose_rmse_dtheta": 0.46014687418937683,
      "pose_rmse_dx": 0.14517612755298615,
      "pose_rmse_dy": 0.04375530034303665,
      "pose_rmse_mean": 0.2163594365119934,
      "rmse_dtheta": 0.05790620297193527,
      "rmse_dx": 0.018015360459685326,
      "rmse_dy": 0.007745685987174511,
      "rmse_mean": 0.027889084070920944,
      "rotation_flip": 0.008196720853447914,
      "sparse_tokens": 3706.0,
      "step": 7176,
      "turn_loss": 0.29780787229537964,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.33344173945363315,
      "grad_norm": 0.5387901663780212,
      "learning_rate": 3.5457299799730047e-06,
      "loss": 0.1258,
      "mae_dtheta": 0.008460554294288158,
      "mae_dx": 0.001618399634025991,
      "mae_dy": 0.0015877137193456292,
      "pose_mae_dtheta": 0.05788050591945648,
      "pose_mae_dx": 0.013474277220666409,
      "pose_mae_dy": 0.017459478229284286,
      "pose_rmse_dtheta": 0.17439678311347961,
      "pose_rmse_dx": 0.0335521325469017,
      "pose_rmse_dy": 0.04880136251449585,
      "pose_rmse_mean": 0.08558343350887299,
      "rmse_dtheta": 0.02407107502222061,
      "rmse_dx": 0.004888787865638733,
      "rmse_dy": 0.0045509845949709415,
      "rmse_mean": 0.01117028295993805,
      "rotation_flip": 0.0031717263627797365,
      "sparse_tokens": 32137.0,
      "step": 7177,
      "turn_loss": 0.09022179991006851,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.3334881992194759,
      "grad_norm": 0.6681693196296692,
      "learning_rate": 3.544464974614527e-06,
      "loss": 0.1364,
      "mae_dtheta": 0.027991030365228653,
      "mae_dx": 0.013414858840405941,
      "mae_dy": 0.004054578021168709,
      "pose_mae_dtheta": 0.21533358097076416,
      "pose_mae_dx": 0.11771412193775177,
      "pose_mae_dy": 0.06029662862420082,
      "pose_rmse_dtheta": 0.3796064555644989,
      "pose_rmse_dx": 0.27880340814590454,
      "pose_rmse_dy": 0.11811317503452301,
      "pose_rmse_mean": 0.25884100794792175,
      "rmse_dtheta": 0.04302995279431343,
      "rmse_dx": 0.028603872284293175,
      "rmse_dy": 0.007290267385542393,
      "rmse_mean": 0.026308029890060425,
      "rotation_flip": 0.014876033179461956,
      "sparse_tokens": 11967.0,
      "step": 7178,
      "turn_loss": 0.18910937011241913,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 2302.0,
      "epoch": 0.3335346589853187,
      "grad_norm": 0.5782525539398193,
      "learning_rate": 3.543200071042393e-06,
      "loss": 0.0907,
      "mae_dtheta": 0.05017926171422005,
      "mae_dx": 0.02420281060039997,
      "mae_dy": 0.02293635532259941,
      "pose_mae_dtheta": 0.2990879416465759,
      "pose_mae_dx": 0.16428923606872559,
      "pose_mae_dy": 0.256448894739151,
      "pose_rmse_dtheta": 0.3864457607269287,
      "pose_rmse_dx": 0.2657449543476105,
      "pose_rmse_dy": 0.3781138062477112,
      "pose_rmse_mean": 0.34343481063842773,
      "rmse_dtheta": 0.06190246716141701,
      "rmse_dx": 0.03483513370156288,
      "rmse_dy": 0.028431568294763565,
      "rmse_mean": 0.04172305762767792,
      "rotation_flip": 0.023076923564076424,
      "sparse_tokens": 2093.0,
      "step": 7179,
      "turn_loss": 0.6206954121589661,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3335811187511615,
      "grad_norm": 0.40402281284332275,
      "learning_rate": 3.541935269345062e-06,
      "loss": 0.096,
      "mae_dtheta": 0.013139847666025162,
      "mae_dx": 0.0029082170221954584,
      "mae_dy": 0.003152556950226426,
      "pose_mae_dtheta": 0.09183505177497864,
      "pose_mae_dx": 0.03334679454565048,
      "pose_mae_dy": 0.0348409004509449,
      "pose_rmse_dtheta": 0.20438720285892487,
      "pose_rmse_dx": 0.08431131392717361,
      "pose_rmse_dy": 0.08084315806627274,
      "pose_rmse_mean": 0.1231805607676506,
      "rmse_dtheta": 0.025943022221326828,
      "rmse_dx": 0.00855913758277893,
      "rmse_dy": 0.007901454344391823,
      "rmse_mean": 0.014134539291262627,
      "rotation_flip": 0.00644468329846859,
      "sparse_tokens": 32105.0,
      "step": 7180,
      "turn_loss": 0.12329690903425217,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.33362757851700425,
      "grad_norm": 0.8117141723632812,
      "learning_rate": 3.5406705696109777e-06,
      "loss": 0.1642,
      "mae_dtheta": 0.03699036315083504,
      "mae_dx": 0.009463571943342686,
      "mae_dy": 0.003341252449899912,
      "pose_mae_dtheta": 0.32851871848106384,
      "pose_mae_dx": 0.07928229868412018,
      "pose_mae_dy": 0.026084160432219505,
      "pose_rmse_dtheta": 0.5624915361404419,
      "pose_rmse_dx": 0.20059844851493835,
      "pose_rmse_dy": 0.07035163789987564,
      "pose_rmse_mean": 0.2778139114379883,
      "rmse_dtheta": 0.05628754198551178,
      "rmse_dx": 0.021238332614302635,
      "rmse_dy": 0.00910339318215847,
      "rmse_mean": 0.028876423835754395,
      "rotation_flip": 0.014218009077012539,
      "sparse_tokens": 10022.0,
      "step": 7181,
      "turn_loss": 0.2476157695055008,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.33367403828284703,
      "grad_norm": 0.4622359573841095,
      "learning_rate": 3.5394059719285867e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.010206492617726326,
      "mae_dx": 0.0027114965487271547,
      "mae_dy": 0.0029176941607147455,
      "pose_mae_dtheta": 0.0674954354763031,
      "pose_mae_dx": 0.03217572346329689,
      "pose_mae_dy": 0.03073316067457199,
      "pose_rmse_dtheta": 0.16631460189819336,
      "pose_rmse_dx": 0.09710013121366501,
      "pose_rmse_dy": 0.07277903705835342,
      "pose_rmse_mean": 0.11206459254026413,
      "rmse_dtheta": 0.02130131796002388,
      "rmse_dx": 0.008740102872252464,
      "rmse_dy": 0.006951689254492521,
      "rmse_mean": 0.012331036850810051,
      "rotation_flip": 0.003446955233812332,
      "sparse_tokens": 32057.0,
      "step": 7182,
      "turn_loss": 0.09591736644506454,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.33372049804868986,
      "grad_norm": 0.5237802267074585,
      "learning_rate": 3.538141476386317e-06,
      "loss": 0.1528,
      "mae_dtheta": 0.027266375720500946,
      "mae_dx": 0.010603200644254684,
      "mae_dy": 0.00566604221239686,
      "pose_mae_dtheta": 0.20636126399040222,
      "pose_mae_dx": 0.07256899029016495,
      "pose_mae_dy": 0.08513199537992477,
      "pose_rmse_dtheta": 0.37555792927742004,
      "pose_rmse_dx": 0.18062686920166016,
      "pose_rmse_dy": 0.16689762473106384,
      "pose_rmse_mean": 0.24102747440338135,
      "rmse_dtheta": 0.04305919259786606,
      "rmse_dx": 0.023911897093057632,
      "rmse_dy": 0.00975746288895607,
      "rmse_mean": 0.025576185435056686,
      "rotation_flip": 0.008948545902967453,
      "sparse_tokens": 8352.0,
      "step": 7183,
      "turn_loss": 0.2592698335647583,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.33376695781453264,
      "grad_norm": 0.4597228765487671,
      "learning_rate": 3.536877083072599e-06,
      "loss": 0.1186,
      "mae_dtheta": 0.029609402641654015,
      "mae_dx": 0.014927400276064873,
      "mae_dy": 0.006817411631345749,
      "pose_mae_dtheta": 0.21357761323451996,
      "pose_mae_dx": 0.12046711146831512,
      "pose_mae_dy": 0.09085850417613983,
      "pose_rmse_dtheta": 0.3687482178211212,
      "pose_rmse_dx": 0.27422910928726196,
      "pose_rmse_dy": 0.17310993373394012,
      "pose_rmse_mean": 0.2720291018486023,
      "rmse_dtheta": 0.045264676213264465,
      "rmse_dx": 0.0298665352165699,
      "rmse_dy": 0.010198932141065598,
      "rmse_mean": 0.028443381190299988,
      "rotation_flip": 0.009302325546741486,
      "sparse_tokens": 8864.0,
      "step": 7184,
      "turn_loss": 0.3106171488761902,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.3338134175803754,
      "grad_norm": 0.6226051449775696,
      "learning_rate": 3.535612792075854e-06,
      "loss": 0.1736,
      "mae_dtheta": 0.040697239339351654,
      "mae_dx": 0.024289721623063087,
      "mae_dy": 0.011009744368493557,
      "pose_mae_dtheta": 0.4042123854160309,
      "pose_mae_dx": 0.19849009811878204,
      "pose_mae_dy": 0.12498831748962402,
      "pose_rmse_dtheta": 0.6094211935997009,
      "pose_rmse_dx": 0.32696497440338135,
      "pose_rmse_dy": 0.24766601622104645,
      "pose_rmse_mean": 0.3946840763092041,
      "rmse_dtheta": 0.056734949350357056,
      "rmse_dx": 0.03541437163949013,
      "rmse_dy": 0.019077830016613007,
      "rmse_mean": 0.0370757170021534,
      "rotation_flip": 0.014184396713972092,
      "sparse_tokens": 2272.0,
      "step": 7185,
      "turn_loss": 0.4573954939842224,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3338598773462182,
      "grad_norm": 0.7350040078163147,
      "learning_rate": 3.5343486034844897e-06,
      "loss": 0.168,
      "mae_dtheta": 0.012604990974068642,
      "mae_dx": 0.0034231424797326326,
      "mae_dy": 0.0048036472871899605,
      "pose_mae_dtheta": 0.09538374096155167,
      "pose_mae_dx": 0.033981047570705414,
      "pose_mae_dy": 0.041591059416532516,
      "pose_rmse_dtheta": 0.2655860483646393,
      "pose_rmse_dx": 0.09201044589281082,
      "pose_rmse_dy": 0.14479504525661469,
      "pose_rmse_mean": 0.16746383905410767,
      "rmse_dtheta": 0.02887309528887272,
      "rmse_dx": 0.01005125418305397,
      "rmse_dy": 0.014096593484282494,
      "rmse_mean": 0.01767364889383316,
      "rotation_flip": 0.004715392366051674,
      "sparse_tokens": 32137.0,
      "step": 7186,
      "turn_loss": 0.13428044319152832,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.33390633711206097,
      "grad_norm": 0.7154364585876465,
      "learning_rate": 3.533084517386917e-06,
      "loss": 0.1673,
      "mae_dtheta": 0.016160329803824425,
      "mae_dx": 0.002647486049681902,
      "mae_dy": 0.004797762259840965,
      "pose_mae_dtheta": 0.1146552637219429,
      "pose_mae_dx": 0.033674392849206924,
      "pose_mae_dy": 0.04499068856239319,
      "pose_rmse_dtheta": 0.27905958890914917,
      "pose_rmse_dx": 0.08813175559043884,
      "pose_rmse_dy": 0.11449339985847473,
      "pose_rmse_mean": 0.16056159138679504,
      "rmse_dtheta": 0.033344119787216187,
      "rmse_dx": 0.006713338661938906,
      "rmse_dy": 0.011056829243898392,
      "rmse_mean": 0.017038095742464066,
      "rotation_flip": 0.006097560748457909,
      "sparse_tokens": 32105.0,
      "step": 7187,
      "turn_loss": 0.1274319738149643,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29108.0,
      "epoch": 0.33395279687790375,
      "grad_norm": 0.8855280876159668,
      "learning_rate": 3.5318205338715296e-06,
      "loss": 0.2489,
      "mae_dtheta": 0.0387115478515625,
      "mae_dx": 0.013606531545519829,
      "mae_dy": 0.006124683655798435,
      "pose_mae_dtheta": 0.314338356256485,
      "pose_mae_dx": 0.10283724218606949,
      "pose_mae_dy": 0.0874510407447815,
      "pose_rmse_dtheta": 0.5355111956596375,
      "pose_rmse_dx": 0.2065703421831131,
      "pose_rmse_dy": 0.17790725827217102,
      "pose_rmse_mean": 0.306662917137146,
      "rmse_dtheta": 0.05700206756591797,
      "rmse_dx": 0.02630995213985443,
      "rmse_dy": 0.010776957497000694,
      "rmse_mean": 0.03136299550533295,
      "rotation_flip": 0.01532033458352089,
      "sparse_tokens": 23673.0,
      "step": 7188,
      "turn_loss": 0.2875191271305084,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.3339992566437465,
      "grad_norm": 0.5257349014282227,
      "learning_rate": 3.5305566530267217e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.024938425049185753,
      "mae_dx": 0.011483009904623032,
      "mae_dy": 0.004335507750511169,
      "pose_mae_dtheta": 0.1819078028202057,
      "pose_mae_dx": 0.11779177188873291,
      "pose_mae_dy": 0.0339466854929924,
      "pose_rmse_dtheta": 0.31014350056648254,
      "pose_rmse_dx": 0.21207499504089355,
      "pose_rmse_dy": 0.06188546121120453,
      "pose_rmse_mean": 0.19470131397247314,
      "rmse_dtheta": 0.037342753261327744,
      "rmse_dx": 0.02228504791855812,
      "rmse_dy": 0.008382866159081459,
      "rmse_mean": 0.02267022244632244,
      "rotation_flip": 0.007874015718698502,
      "sparse_tokens": 4957.0,
      "step": 7189,
      "turn_loss": 0.14672806859016418,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3340457164095893,
      "grad_norm": 0.4805937707424164,
      "learning_rate": 3.529292874940874e-06,
      "loss": 0.1183,
      "mae_dtheta": 0.011815562844276428,
      "mae_dx": 0.0022296521347016096,
      "mae_dy": 0.002696024253964424,
      "pose_mae_dtheta": 0.0790153443813324,
      "pose_mae_dx": 0.026493990793824196,
      "pose_mae_dy": 0.027605650946497917,
      "pose_rmse_dtheta": 0.21493718028068542,
      "pose_rmse_dx": 0.05986174941062927,
      "pose_rmse_dy": 0.06943236291408539,
      "pose_rmse_mean": 0.11474376916885376,
      "rmse_dtheta": 0.027669120579957962,
      "rmse_dx": 0.005611528176814318,
      "rmse_dy": 0.006627361755818129,
      "rmse_mean": 0.013302670791745186,
      "rotation_flip": 0.006008261349052191,
      "sparse_tokens": 32185.0,
      "step": 7190,
      "turn_loss": 0.09009270370006561,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3340921761754321,
      "grad_norm": 0.524213433265686,
      "learning_rate": 3.5280291997023653e-06,
      "loss": 0.1641,
      "mae_dtheta": 0.011667697690427303,
      "mae_dx": 0.0027924436144530773,
      "mae_dy": 0.003004402620717883,
      "pose_mae_dtheta": 0.08033347874879837,
      "pose_mae_dx": 0.02856266126036644,
      "pose_mae_dy": 0.027301983907818794,
      "pose_rmse_dtheta": 0.1819063276052475,
      "pose_rmse_dx": 0.0790276825428009,
      "pose_rmse_dy": 0.060025811195373535,
      "pose_rmse_mean": 0.10698660463094711,
      "rmse_dtheta": 0.023926086723804474,
      "rmse_dx": 0.007829077541828156,
      "rmse_dy": 0.008002138696610928,
      "rmse_mean": 0.013252435252070427,
      "rotation_flip": 0.008132836781442165,
      "sparse_tokens": 32169.0,
      "step": 7191,
      "turn_loss": 0.1280776709318161,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.33413863594127485,
      "grad_norm": 0.5668865442276001,
      "learning_rate": 3.5267656273995655e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.010618451982736588,
      "mae_dx": 0.00184376141987741,
      "mae_dy": 0.0030546137131750584,
      "pose_mae_dtheta": 0.07743029296398163,
      "pose_mae_dx": 0.025567375123500824,
      "pose_mae_dy": 0.030624056234955788,
      "pose_rmse_dtheta": 0.2121625691652298,
      "pose_rmse_dx": 0.07332725077867508,
      "pose_rmse_dy": 0.07182998955249786,
      "pose_rmse_mean": 0.11910661309957504,
      "rmse_dtheta": 0.02507721073925495,
      "rmse_dx": 0.005718107335269451,
      "rmse_dy": 0.007569844368845224,
      "rmse_mean": 0.012788387946784496,
      "rotation_flip": 0.0018960940651595592,
      "sparse_tokens": 32121.0,
      "step": 7192,
      "turn_loss": 0.08724728226661682,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.33418509570711763,
      "grad_norm": 0.4534202516078949,
      "learning_rate": 3.525502158120836e-06,
      "loss": 0.1024,
      "mae_dtheta": 0.00862119160592556,
      "mae_dx": 0.0011628465726971626,
      "mae_dy": 0.0018006148748099804,
      "pose_mae_dtheta": 0.05959388241171837,
      "pose_mae_dx": 0.015701547265052795,
      "pose_mae_dy": 0.023946497589349747,
      "pose_rmse_dtheta": 0.17781594395637512,
      "pose_rmse_dx": 0.04010092467069626,
      "pose_rmse_dy": 0.06824832409620285,
      "pose_rmse_mean": 0.09538840502500534,
      "rmse_dtheta": 0.02071668766438961,
      "rmse_dx": 0.003533785231411457,
      "rmse_dy": 0.004163101781159639,
      "rmse_mean": 0.00947119202464819,
      "rotation_flip": 0.003553098998963833,
      "sparse_tokens": 32089.0,
      "step": 7193,
      "turn_loss": 0.05965173989534378,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.3342315554729604,
      "grad_norm": 0.5460822582244873,
      "learning_rate": 3.524238791954532e-06,
      "loss": 0.1632,
      "mae_dtheta": 0.04884115606546402,
      "mae_dx": 0.018333135172724724,
      "mae_dy": 0.008394863456487656,
      "pose_mae_dtheta": 0.4161171615123749,
      "pose_mae_dx": 0.1541692614555359,
      "pose_mae_dy": 0.065128393471241,
      "pose_rmse_dtheta": 0.6043297648429871,
      "pose_rmse_dx": 0.28446924686431885,
      "pose_rmse_dy": 0.1451040655374527,
      "pose_rmse_mean": 0.34463438391685486,
      "rmse_dtheta": 0.0641743391752243,
      "rmse_dx": 0.029894571751356125,
      "rmse_dy": 0.017265500500798225,
      "rmse_mean": 0.037111472338438034,
      "rotation_flip": 0.014423076994717121,
      "sparse_tokens": 9969.0,
      "step": 7194,
      "turn_loss": 0.46239882707595825,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.3342780152388032,
      "grad_norm": 0.38661548495292664,
      "learning_rate": 3.5229755289890005e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.03476851060986519,
      "mae_dx": 0.012133046053349972,
      "mae_dy": 0.00542345829308033,
      "pose_mae_dtheta": 0.27245333790779114,
      "pose_mae_dx": 0.0801786258816719,
      "pose_mae_dy": 0.0581846684217453,
      "pose_rmse_dtheta": 0.47102802991867065,
      "pose_rmse_dx": 0.18051691353321075,
      "pose_rmse_dy": 0.17213380336761475,
      "pose_rmse_mean": 0.2745595872402191,
      "rmse_dtheta": 0.05382991209626198,
      "rmse_dx": 0.023976439610123634,
      "rmse_dy": 0.013556537218391895,
      "rmse_mean": 0.030454298481345177,
      "rotation_flip": 0.015948962420225143,
      "sparse_tokens": 22176.0,
      "step": 7195,
      "turn_loss": 0.3062678277492523,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.33432447500464596,
      "grad_norm": 0.5188817977905273,
      "learning_rate": 3.5217123693125827e-06,
      "loss": 0.0887,
      "mae_dtheta": 0.040337078273296356,
      "mae_dx": 0.012066107243299484,
      "mae_dy": 0.007861925289034843,
      "pose_mae_dtheta": 0.2998468577861786,
      "pose_mae_dx": 0.09036742895841599,
      "pose_mae_dy": 0.0695861279964447,
      "pose_rmse_dtheta": 0.540132999420166,
      "pose_rmse_dx": 0.19886581599712372,
      "pose_rmse_dy": 0.16053363680839539,
      "pose_rmse_mean": 0.2998441457748413,
      "rmse_dtheta": 0.06026694178581238,
      "rmse_dx": 0.024600187316536903,
      "rmse_dy": 0.0171806737780571,
      "rmse_mean": 0.03401593491435051,
      "rotation_flip": 0.032258063554763794,
      "sparse_tokens": 7591.0,
      "step": 7196,
      "turn_loss": 0.40123599767684937,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.33437093477048874,
      "grad_norm": 0.5183066129684448,
      "learning_rate": 3.520449313013614e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.011195833794772625,
      "mae_dx": 0.0019689134787768126,
      "mae_dy": 0.001527005690149963,
      "pose_mae_dtheta": 0.07989683747291565,
      "pose_mae_dx": 0.018781686201691628,
      "pose_mae_dy": 0.022030174732208252,
      "pose_rmse_dtheta": 0.21049325168132782,
      "pose_rmse_dx": 0.05012839287519455,
      "pose_rmse_dy": 0.048643480986356735,
      "pose_rmse_mean": 0.1030883714556694,
      "rmse_dtheta": 0.026283230632543564,
      "rmse_dx": 0.006654676981270313,
      "rmse_dy": 0.0030537648126482964,
      "rmse_mean": 0.011997224763035774,
      "rotation_flip": 0.0025466892402619123,
      "sparse_tokens": 32137.0,
      "step": 7197,
      "turn_loss": 0.07590965926647186,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29754.0,
      "epoch": 0.3344173945363315,
      "grad_norm": 0.5878392457962036,
      "learning_rate": 3.5191863601804178e-06,
      "loss": 0.1716,
      "mae_dtheta": 0.032608918845653534,
      "mae_dx": 0.01408496405929327,
      "mae_dy": 0.007820210419595242,
      "pose_mae_dtheta": 0.2612343728542328,
      "pose_mae_dx": 0.11536319553852081,
      "pose_mae_dy": 0.0873483270406723,
      "pose_rmse_dtheta": 0.4530572295188904,
      "pose_rmse_dx": 0.25051990151405334,
      "pose_rmse_dy": 0.18027213215827942,
      "pose_rmse_mean": 0.2946164309978485,
      "rmse_dtheta": 0.04872802644968033,
      "rmse_dx": 0.027717456221580505,
      "rmse_dy": 0.01701490208506584,
      "rmse_mean": 0.03115346096456051,
      "rotation_flip": 0.016212232410907745,
      "sparse_tokens": 25214.0,
      "step": 7198,
      "turn_loss": 0.35088464617729187,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3344638543021743,
      "grad_norm": 0.43897944688796997,
      "learning_rate": 3.5179235109013157e-06,
      "loss": 0.1297,
      "mae_dtheta": 0.009072295390069485,
      "mae_dx": 0.0015943805919960141,
      "mae_dy": 0.001398502616211772,
      "pose_mae_dtheta": 0.0629071444272995,
      "pose_mae_dx": 0.01643841154873371,
      "pose_mae_dy": 0.022031480446457863,
      "pose_rmse_dtheta": 0.17685680091381073,
      "pose_rmse_dx": 0.045571379363536835,
      "pose_rmse_dy": 0.047907356172800064,
      "pose_rmse_mean": 0.09011184424161911,
      "rmse_dtheta": 0.022154316306114197,
      "rmse_dx": 0.005128439981490374,
      "rmse_dy": 0.0028269533067941666,
      "rmse_mean": 0.010036570020020008,
      "rotation_flip": 0.002722322940826416,
      "sparse_tokens": 32121.0,
      "step": 7199,
      "turn_loss": 0.0575430653989315,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.3345103140680171,
      "grad_norm": 0.7292014360427856,
      "learning_rate": 3.516660765264616e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.015987791121006012,
      "mae_dx": 0.004259588196873665,
      "mae_dy": 0.0021674265153706074,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7292013168334961,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 175.0816650390625,
      "model/head/act_norm_mean": 103.96502130681819,
      "model/head/act_norm_min": 58.478294372558594,
      "model/head/act_over_embed": 71.44573597791009,
      "model/head/grad_frac": 0.08777151256799698,
      "model/head/grad_norm": 0.0640031024813652,
      "model/head/grad_zero_frac": 0.0001881421630969271,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.700387665719697,
      "model/head/update_ratio": 0.0010913662845268846,
      "model/head/weight_delta": 9.45556354522705,
      "model/head/weight_delta_rel": 0.16587859392166138,
      "model/head/weight_norm": 58.644935607910156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4218415915966034,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4217862964171097,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42172619700431824,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2898554917233596,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06124379113316536,
      "model/modality_embedder.encoders.pose/grad_norm": 0.044659052044153214,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.4942459802904564,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014425036497414112,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0412306785583496,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09936648607254028,
      "model/modality_embedder.encoders.pose/weight_norm": 30.95940399169922,
      "model/modality_embedder/grad_frac": 0.06124379113316536,
      "model/modality_embedder/grad_norm": 0.044659052044153214,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.4942459802904564,
      "model/modality_embedder/update_ratio": 0.0014425036497414112,
      "model/modality_embedder/weight_delta": 3.0412306785583496,
      "model/modality_embedder/weight_delta_rel": 0.09936648607254028,
      "model/modality_embedder/weight_norm": 30.95940399169922,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.79834747314453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.051602332852333,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.145296096801758,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.841276935637344,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0719914436340332,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05249625816941261,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018812237540259957,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.489623785018921,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09072339534759521,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.905376434326172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.22016143798828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.973597582972584,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.244500160217285,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.47488070337551,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07178446650505066,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05234532803297043,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001763656036928296,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1584463119506836,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10941104590892792,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.680009841918945,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.4749526977539,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.69147326438993,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.557782173156738,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.65542095465103,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07752598822116852,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05653205141425133,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018447191687300801,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.409961462020874,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11450012028217316,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.645343780517578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.32404327392578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.450341710758376,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.966996192932129,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.86413181778126,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.099130779504776,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07228629291057587,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002419122261926532,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.918057441711426,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09972535818815231,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.881206512451172,
      "model/normalizer/grad_frac": 0.3912641704082489,
      "model/normalizer/grad_norm": 0.2853103578090668,
      "model/normalizer/grad_zero_frac": 0.00018907814228441566,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0036319324281066656,
      "model/normalizer/weight_delta": 6.16664457321167,
      "model/normalizer/weight_delta_rel": 0.07942280918359756,
      "model/normalizer/weight_norm": 78.55607604980469,
      "pose_mae_dtheta": 0.12252127379179001,
      "pose_mae_dx": 0.03652046620845795,
      "pose_mae_dy": 0.027943897992372513,
      "pose_rmse_dtheta": 0.3238353133201599,
      "pose_rmse_dx": 0.09803058952093124,
      "pose_rmse_dy": 0.07919526100158691,
      "pose_rmse_mean": 0.16702041029930115,
      "rmse_dtheta": 0.03534507751464844,
      "rmse_dx": 0.011681982316076756,
      "rmse_dy": 0.006198331713676453,
      "rmse_mean": 0.017741797491908073,
      "rotation_flip": 0.00448979577049613,
      "sparse_tokens": 32249.0,
      "step": 7200,
      "turn_loss": 0.12638887763023376,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.3345103140680171,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3105217516422272,
      "eval_objectnav_nopose_mae_dtheta": 0.03879488632082939,
      "eval_objectnav_nopose_mae_dx": 0.01304219476878643,
      "eval_objectnav_nopose_mae_dy": 0.00500869145616889,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3097728192806244,
      "eval_objectnav_nopose_pose_mae_dx": 0.10382111370563507,
      "eval_objectnav_nopose_pose_mae_dy": 0.05355501547455788,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5310609340667725,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23024581372737885,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12782154977321625,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29637610912323,
      "eval_objectnav_nopose_rmse_dtheta": 0.056747324764728546,
      "eval_objectnav_nopose_rmse_dx": 0.025704018771648407,
      "eval_objectnav_nopose_rmse_dy": 0.010425212793052197,
      "eval_objectnav_nopose_rmse_mean": 0.03095885179936886,
      "eval_objectnav_nopose_rotation_flip": 0.014172447845339775,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3105217516422272,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 7200
    },
    {
      "epoch": 0.3345103140680171,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28017258644104004,
      "eval_objectnav_pose_mae_dtheta": 0.03510133549571037,
      "eval_objectnav_pose_mae_dx": 0.011301791295409203,
      "eval_objectnav_pose_mae_dy": 0.004696862306445837,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26214542984962463,
      "eval_objectnav_pose_pose_mae_dx": 0.08915908634662628,
      "eval_objectnav_pose_pose_mae_dy": 0.04937564209103584,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4637031555175781,
      "eval_objectnav_pose_pose_rmse_dx": 0.2063567340373993,
      "eval_objectnav_pose_pose_rmse_dy": 0.11981220543384552,
      "eval_objectnav_pose_pose_rmse_mean": 0.2632907032966614,
      "eval_objectnav_pose_rmse_dtheta": 0.052832454442977905,
      "eval_objectnav_pose_rmse_dx": 0.02351154200732708,
      "eval_objectnav_pose_rmse_dy": 0.009887847118079662,
      "eval_objectnav_pose_rmse_mean": 0.02874394878745079,
      "eval_objectnav_pose_rotation_flip": 0.01508485246449709,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28017258644104004,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 7200
    },
    {
      "epoch": 0.3345103140680171,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09258399158716202,
      "eval_pointnav_mae_dtheta": 0.0106853898614645,
      "eval_pointnav_mae_dx": 0.0023603434674441814,
      "eval_pointnav_mae_dy": 0.0024265828542411327,
      "eval_pointnav_pose_mae_dtheta": 0.07469896227121353,
      "eval_pointnav_pose_mae_dx": 0.026211168617010117,
      "eval_pointnav_pose_mae_dy": 0.02625361457467079,
      "eval_pointnav_pose_rmse_dtheta": 0.2133309245109558,
      "eval_pointnav_pose_rmse_dx": 0.07880305498838425,
      "eval_pointnav_pose_rmse_dy": 0.07414128631353378,
      "eval_pointnav_pose_rmse_mean": 0.12209176272153854,
      "eval_pointnav_rmse_dtheta": 0.02618500590324402,
      "eval_pointnav_rmse_dx": 0.007449428550899029,
      "eval_pointnav_rmse_dy": 0.006394358817487955,
      "eval_pointnav_rmse_mean": 0.013342931866645813,
      "eval_pointnav_rotation_flip": 0.0046254657208919525,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09258399158716202,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 7200
    },
    {
      "epoch": 0.3345103140680171,
      "eval_loss": 0.2277594432234764,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3105217516422272,
      "eval_objectnav_nopose_mae_dtheta": 0.03879488632082939,
      "eval_objectnav_nopose_mae_dx": 0.01304219476878643,
      "eval_objectnav_nopose_mae_dy": 0.00500869145616889,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3097728192806244,
      "eval_objectnav_nopose_pose_mae_dx": 0.10382111370563507,
      "eval_objectnav_nopose_pose_mae_dy": 0.05355501547455788,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5310609340667725,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23024581372737885,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12782154977321625,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29637610912323,
      "eval_objectnav_nopose_rmse_dtheta": 0.056747324764728546,
      "eval_objectnav_nopose_rmse_dx": 0.025704018771648407,
      "eval_objectnav_nopose_rmse_dy": 0.010425212793052197,
      "eval_objectnav_nopose_rmse_mean": 0.03095885179936886,
      "eval_objectnav_nopose_rotation_flip": 0.014172447845339775,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3105217516422272,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.28017258644104004,
      "eval_objectnav_pose_mae_dtheta": 0.03510133549571037,
      "eval_objectnav_pose_mae_dx": 0.011301791295409203,
      "eval_objectnav_pose_mae_dy": 0.004696862306445837,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26214542984962463,
      "eval_objectnav_pose_pose_mae_dx": 0.08915908634662628,
      "eval_objectnav_pose_pose_mae_dy": 0.04937564209103584,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4637031555175781,
      "eval_objectnav_pose_pose_rmse_dx": 0.2063567340373993,
      "eval_objectnav_pose_pose_rmse_dy": 0.11981220543384552,
      "eval_objectnav_pose_pose_rmse_mean": 0.2632907032966614,
      "eval_objectnav_pose_rmse_dtheta": 0.052832454442977905,
      "eval_objectnav_pose_rmse_dx": 0.02351154200732708,
      "eval_objectnav_pose_rmse_dy": 0.009887847118079662,
      "eval_objectnav_pose_rmse_mean": 0.02874394878745079,
      "eval_objectnav_pose_rotation_flip": 0.01508485246449709,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.28017258644104004,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09258399158716202,
      "eval_pointnav_mae_dtheta": 0.0106853898614645,
      "eval_pointnav_mae_dx": 0.0023603434674441814,
      "eval_pointnav_mae_dy": 0.0024265828542411327,
      "eval_pointnav_pose_mae_dtheta": 0.07469896227121353,
      "eval_pointnav_pose_mae_dx": 0.026211168617010117,
      "eval_pointnav_pose_mae_dy": 0.02625361457467079,
      "eval_pointnav_pose_rmse_dtheta": 0.2133309245109558,
      "eval_pointnav_pose_rmse_dx": 0.07880305498838425,
      "eval_pointnav_pose_rmse_dy": 0.07414128631353378,
      "eval_pointnav_pose_rmse_mean": 0.12209176272153854,
      "eval_pointnav_rmse_dtheta": 0.02618500590324402,
      "eval_pointnav_rmse_dx": 0.007449428550899029,
      "eval_pointnav_rmse_dy": 0.006394358817487955,
      "eval_pointnav_rmse_mean": 0.013342931866645813,
      "eval_pointnav_rotation_flip": 0.0046254657208919525,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09258399158716202,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 7200
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.3345567738338599,
      "grad_norm": 0.3644866943359375,
      "learning_rate": 3.5153981233586277e-06,
      "loss": 0.0787,
      "mae_dtheta": 0.030485359951853752,
      "mae_dx": 0.011835433542728424,
      "mae_dy": 0.0033865675795823336,
      "pose_mae_dtheta": 0.2484978586435318,
      "pose_mae_dx": 0.09097728878259659,
      "pose_mae_dy": 0.038355011492967606,
      "pose_rmse_dtheta": 0.4715416729450226,
      "pose_rmse_dx": 0.1869276612997055,
      "pose_rmse_dy": 0.09206138551235199,
      "pose_rmse_mean": 0.25017690658569336,
      "rmse_dtheta": 0.04976965859532356,
      "rmse_dx": 0.022863177582621574,
      "rmse_dy": 0.006165825761854649,
      "rmse_mean": 0.026266220957040787,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 10744.0,
      "step": 7201,
      "turn_loss": 0.2602255344390869,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 30723.0,
      "epoch": 0.3346032335997027,
      "grad_norm": 0.5665191411972046,
      "learning_rate": 3.5141355852716424e-06,
      "loss": 0.1652,
      "mae_dtheta": 0.03685366362333298,
      "mae_dx": 0.018418533727526665,
      "mae_dy": 0.005331413820385933,
      "pose_mae_dtheta": 0.30006179213523865,
      "pose_mae_dx": 0.1499147266149521,
      "pose_mae_dy": 0.05905483663082123,
      "pose_rmse_dtheta": 0.5104253888130188,
      "pose_rmse_dx": 0.2984391450881958,
      "pose_rmse_dy": 0.13888046145439148,
      "pose_rmse_mean": 0.31591498851776123,
      "rmse_dtheta": 0.05435634031891823,
      "rmse_dx": 0.03170247748494148,
      "rmse_dy": 0.011718598194420338,
      "rmse_mean": 0.03259247541427612,
      "rotation_flip": 0.011013215407729149,
      "sparse_tokens": 24147.0,
      "step": 7202,
      "turn_loss": 0.32690760493278503,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.33464969336554545,
      "grad_norm": 0.47189486026763916,
      "learning_rate": 3.5128731510919535e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.007696970831602812,
      "mae_dx": 0.0009069668594747782,
      "mae_dy": 0.001506385742686689,
      "pose_mae_dtheta": 0.05235973000526428,
      "pose_mae_dx": 0.013686047866940498,
      "pose_mae_dy": 0.018450288102030754,
      "pose_rmse_dtheta": 0.18406201899051666,
      "pose_rmse_dx": 0.03745199739933014,
      "pose_rmse_dy": 0.05099060758948326,
      "pose_rmse_mean": 0.09083487838506699,
      "rmse_dtheta": 0.0216812901198864,
      "rmse_dx": 0.0025508457329124212,
      "rmse_dy": 0.0033614453859627247,
      "rmse_mean": 0.009197860956192017,
      "rotation_flip": 0.005630142986774445,
      "sparse_tokens": 32089.0,
      "step": 7203,
      "turn_loss": 0.0525948591530323,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.33469615313138823,
      "grad_norm": 0.4889175593852997,
      "learning_rate": 3.511610820907846e-06,
      "loss": 0.09,
      "mae_dtheta": 0.04013795405626297,
      "mae_dx": 0.009970941580832005,
      "mae_dy": 0.0029061452951282263,
      "pose_mae_dtheta": 0.297845721244812,
      "pose_mae_dx": 0.07609643042087555,
      "pose_mae_dy": 0.0383254736661911,
      "pose_rmse_dtheta": 0.5237357020378113,
      "pose_rmse_dx": 0.23134282231330872,
      "pose_rmse_dy": 0.0941782221198082,
      "pose_rmse_mean": 0.28308558464050293,
      "rmse_dtheta": 0.05959874019026756,
      "rmse_dx": 0.02281353808939457,
      "rmse_dy": 0.005902841687202454,
      "rmse_mean": 0.029438374564051628,
      "rotation_flip": 0.019662922248244286,
      "sparse_tokens": 5398.0,
      "step": 7204,
      "turn_loss": 0.2949727773666382,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.334742612897231,
      "grad_norm": 0.4479382336139679,
      "learning_rate": 3.51034859480759e-06,
      "loss": 0.1352,
      "mae_dtheta": 0.04614651948213577,
      "mae_dx": 0.013795113191008568,
      "mae_dy": 0.004099277779459953,
      "pose_mae_dtheta": 0.3857830762863159,
      "pose_mae_dx": 0.10776713490486145,
      "pose_mae_dy": 0.04094235226511955,
      "pose_rmse_dtheta": 0.6243749260902405,
      "pose_rmse_dx": 0.2387295514345169,
      "pose_rmse_dy": 0.10271482914686203,
      "pose_rmse_mean": 0.32193976640701294,
      "rmse_dtheta": 0.06471941620111465,
      "rmse_dx": 0.02652558498084545,
      "rmse_dy": 0.008962077088654041,
      "rmse_mean": 0.03340236097574234,
      "rotation_flip": 0.024479804560542107,
      "sparse_tokens": 12410.0,
      "step": 7205,
      "turn_loss": 0.3150288462638855,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 39466.0,
      "epoch": 0.3347890726630738,
      "grad_norm": 0.4749740958213806,
      "learning_rate": 3.5090864728794583e-06,
      "loss": 0.1155,
      "mae_dtheta": 0.034992050379514694,
      "mae_dx": 0.011779792606830597,
      "mae_dy": 0.004297343082726002,
      "pose_mae_dtheta": 0.2690970301628113,
      "pose_mae_dx": 0.08502323180437088,
      "pose_mae_dy": 0.04961303994059563,
      "pose_rmse_dtheta": 0.5025627613067627,
      "pose_rmse_dx": 0.18369929492473602,
      "pose_rmse_dy": 0.13225984573364258,
      "pose_rmse_mean": 0.2728406488895416,
      "rmse_dtheta": 0.05481383576989174,
      "rmse_dx": 0.023130856454372406,
      "rmse_dy": 0.009823093190789223,
      "rmse_mean": 0.029255930334329605,
      "rotation_flip": 0.01606425642967224,
      "sparse_tokens": 29559.0,
      "step": 7206,
      "turn_loss": 0.27206894755363464,
      "turns": 122.0,
      "turns_per_sample": 122.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.33483553242891656,
      "grad_norm": 0.4180259704589844,
      "learning_rate": 3.507824455211708e-06,
      "loss": 0.0884,
      "mae_dtheta": 0.00945449247956276,
      "mae_dx": 0.001401109853759408,
      "mae_dy": 0.0026112247724086046,
      "pose_mae_dtheta": 0.060747984796762466,
      "pose_mae_dx": 0.022084759548306465,
      "pose_mae_dy": 0.030898278579115868,
      "pose_rmse_dtheta": 0.1255435049533844,
      "pose_rmse_dx": 0.06201431527733803,
      "pose_rmse_dy": 0.06726307421922684,
      "pose_rmse_mean": 0.08494029939174652,
      "rmse_dtheta": 0.017977271229028702,
      "rmse_dx": 0.005083262454718351,
      "rmse_dy": 0.005606980994343758,
      "rmse_mean": 0.009555839002132416,
      "rotation_flip": 0.003374578198418021,
      "sparse_tokens": 32041.0,
      "step": 7207,
      "turn_loss": 0.0758850947022438,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18183.0,
      "epoch": 0.33488199219475934,
      "grad_norm": 0.44173550605773926,
      "learning_rate": 3.5065625418925965e-06,
      "loss": 0.1041,
      "mae_dtheta": 0.024619486182928085,
      "mae_dx": 0.013592138886451721,
      "mae_dy": 0.004716992378234863,
      "pose_mae_dtheta": 0.15647590160369873,
      "pose_mae_dx": 0.0996895432472229,
      "pose_mae_dy": 0.05190363526344299,
      "pose_rmse_dtheta": 0.31203973293304443,
      "pose_rmse_dx": 0.23146843910217285,
      "pose_rmse_dy": 0.12586218118667603,
      "pose_rmse_mean": 0.2231234610080719,
      "rmse_dtheta": 0.0417180135846138,
      "rmse_dx": 0.027141310274600983,
      "rmse_dy": 0.009431113488972187,
      "rmse_mean": 0.02609681338071823,
      "rotation_flip": 0.011583011597394943,
      "sparse_tokens": 14952.0,
      "step": 7208,
      "turn_loss": 0.23974187672138214,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3349284519606021,
      "grad_norm": 0.49780064821243286,
      "learning_rate": 3.505300733010366e-06,
      "loss": 0.0634,
      "mae_dtheta": 0.007567982655018568,
      "mae_dx": 0.0012306567514315248,
      "mae_dy": 0.0009244151297025383,
      "pose_mae_dtheta": 0.05441104993224144,
      "pose_mae_dx": 0.011337953619658947,
      "pose_mae_dy": 0.015812527388334274,
      "pose_rmse_dtheta": 0.18899109959602356,
      "pose_rmse_dx": 0.028214385733008385,
      "pose_rmse_dy": 0.039029862731695175,
      "pose_rmse_mean": 0.08541177958250046,
      "rmse_dtheta": 0.022280419245362282,
      "rmse_dx": 0.004190660547465086,
      "rmse_dy": 0.0019927402026951313,
      "rmse_mean": 0.0094879399985075,
      "rotation_flip": 0.002337814075872302,
      "sparse_tokens": 32089.0,
      "step": 7209,
      "turn_loss": 0.054524410516023636,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3349749117264449,
      "grad_norm": 0.36163103580474854,
      "learning_rate": 3.5040390286532584e-06,
      "loss": 0.0689,
      "mae_dtheta": 0.008185876533389091,
      "mae_dx": 0.001767260255292058,
      "mae_dy": 0.0015629887348040938,
      "pose_mae_dtheta": 0.05563856288790703,
      "pose_mae_dx": 0.01602698303759098,
      "pose_mae_dy": 0.019675027579069138,
      "pose_rmse_dtheta": 0.15186306834220886,
      "pose_rmse_dx": 0.041115619242191315,
      "pose_rmse_dy": 0.04145289584994316,
      "pose_rmse_mean": 0.07814386487007141,
      "rmse_dtheta": 0.020198237150907516,
      "rmse_dx": 0.006152019370347261,
      "rmse_dy": 0.0043622818775475025,
      "rmse_mean": 0.010237513110041618,
      "rotation_flip": 0.002851711120456457,
      "sparse_tokens": 32089.0,
      "step": 7210,
      "turn_loss": 0.0759180337190628,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.33502137149228767,
      "grad_norm": 0.584073007106781,
      "learning_rate": 3.5027774289095046e-06,
      "loss": 0.1454,
      "mae_dtheta": 0.029720352962613106,
      "mae_dx": 0.01083593349903822,
      "mae_dy": 0.0047641415148973465,
      "pose_mae_dtheta": 0.24317091703414917,
      "pose_mae_dx": 0.08079361915588379,
      "pose_mae_dy": 0.0545598641037941,
      "pose_rmse_dtheta": 0.4125291109085083,
      "pose_rmse_dx": 0.17889752984046936,
      "pose_rmse_dy": 0.14774270355701447,
      "pose_rmse_mean": 0.24638977646827698,
      "rmse_dtheta": 0.04635647311806679,
      "rmse_dx": 0.022392597049474716,
      "rmse_dy": 0.011926020495593548,
      "rmse_mean": 0.026891697198152542,
      "rotation_flip": 0.014274980872869492,
      "sparse_tokens": 20297.0,
      "step": 7211,
      "turn_loss": 0.20827817916870117,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.33506783125813044,
      "grad_norm": 0.7524014115333557,
      "learning_rate": 3.5015159338673286e-06,
      "loss": 0.1613,
      "mae_dtheta": 0.008121239952743053,
      "mae_dx": 0.000965664628893137,
      "mae_dy": 0.0010993810137733817,
      "pose_mae_dtheta": 0.06193413957953453,
      "pose_mae_dx": 0.014126574620604515,
      "pose_mae_dy": 0.0156421959400177,
      "pose_rmse_dtheta": 0.23136591911315918,
      "pose_rmse_dx": 0.04353916645050049,
      "pose_rmse_dy": 0.05260559543967247,
      "pose_rmse_mean": 0.10917022824287415,
      "rmse_dtheta": 0.024803780019283295,
      "rmse_dx": 0.0031630725134164095,
      "rmse_dy": 0.0029216634575277567,
      "rmse_mean": 0.010296172462403774,
      "rotation_flip": 0.002794857369735837,
      "sparse_tokens": 32073.0,
      "step": 7212,
      "turn_loss": 0.051949385553598404,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.3351142910239732,
      "grad_norm": 0.45026257634162903,
      "learning_rate": 3.5002545436149478e-06,
      "loss": 0.0864,
      "mae_dtheta": 0.0482085645198822,
      "mae_dx": 0.01662408746778965,
      "mae_dy": 0.006039912346750498,
      "pose_mae_dtheta": 0.3839232623577118,
      "pose_mae_dx": 0.10220492631196976,
      "pose_mae_dy": 0.08933015912771225,
      "pose_rmse_dtheta": 0.689233124256134,
      "pose_rmse_dx": 0.2473227083683014,
      "pose_rmse_dy": 0.2010311335325241,
      "pose_rmse_mean": 0.3791956603527069,
      "rmse_dtheta": 0.07189492881298065,
      "rmse_dx": 0.03098798170685768,
      "rmse_dy": 0.011226450093090534,
      "rmse_mean": 0.03803645446896553,
      "rotation_flip": 0.01550387591123581,
      "sparse_tokens": 3950.0,
      "step": 7213,
      "turn_loss": 0.2734881639480591,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.335160750789816,
      "grad_norm": 0.6362437009811401,
      "learning_rate": 3.4989932582405715e-06,
      "loss": 0.107,
      "mae_dtheta": 0.01098079513758421,
      "mae_dx": 0.0014626774936914444,
      "mae_dy": 0.0024094802793115377,
      "pose_mae_dtheta": 0.06866971403360367,
      "pose_mae_dx": 0.020859116688370705,
      "pose_mae_dy": 0.029227977618575096,
      "pose_rmse_dtheta": 0.15068113803863525,
      "pose_rmse_dx": 0.04742076247930527,
      "pose_rmse_dy": 0.06536778807640076,
      "pose_rmse_mean": 0.08782323449850082,
      "rmse_dtheta": 0.023809073492884636,
      "rmse_dx": 0.004420414566993713,
      "rmse_dy": 0.004939503502100706,
      "rmse_mean": 0.011056330054998398,
      "rotation_flip": 0.004885381553322077,
      "sparse_tokens": 32073.0,
      "step": 7214,
      "turn_loss": 0.09150940179824829,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3352072105556588,
      "grad_norm": 0.6719960570335388,
      "learning_rate": 3.4977320778324015e-06,
      "loss": 0.1516,
      "mae_dtheta": 0.007528133690357208,
      "mae_dx": 0.0011009449372068048,
      "mae_dy": 0.0012026387266814709,
      "pose_mae_dtheta": 0.0569097138941288,
      "pose_mae_dx": 0.015308845788240433,
      "pose_mae_dy": 0.02091393619775772,
      "pose_rmse_dtheta": 0.16825589537620544,
      "pose_rmse_dx": 0.03969838097691536,
      "pose_rmse_dy": 0.05148102343082428,
      "pose_rmse_mean": 0.08647843450307846,
      "rmse_dtheta": 0.019925415515899658,
      "rmse_dx": 0.004162321798503399,
      "rmse_dy": 0.0025386600755155087,
      "rmse_mean": 0.008875466883182526,
      "rotation_flip": 0.0015715033514425159,
      "sparse_tokens": 32041.0,
      "step": 7215,
      "turn_loss": 0.05066842585802078,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3352536703215016,
      "grad_norm": 0.4590047001838684,
      "learning_rate": 3.4964710024786354e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.010023082606494427,
      "mae_dx": 0.0017729511018842459,
      "mae_dy": 0.002920987317338586,
      "pose_mae_dtheta": 0.06939104199409485,
      "pose_mae_dx": 0.02216164395213127,
      "pose_mae_dy": 0.022305216640233994,
      "pose_rmse_dtheta": 0.20681260526180267,
      "pose_rmse_dx": 0.05502835288643837,
      "pose_rmse_dy": 0.04711540415883064,
      "pose_rmse_mean": 0.10298546403646469,
      "rmse_dtheta": 0.024251772090792656,
      "rmse_dx": 0.004293523263186216,
      "rmse_dy": 0.0063529242761433125,
      "rmse_mean": 0.011632740497589111,
      "rotation_flip": 0.001123595517128706,
      "sparse_tokens": 32089.0,
      "step": 7216,
      "turn_loss": 0.08184126764535904,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.3353001300873444,
      "grad_norm": 0.5460197925567627,
      "learning_rate": 3.4952100322674574e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.03438611701130867,
      "mae_dx": 0.006271819584071636,
      "mae_dy": 0.0034007285721600056,
      "pose_mae_dtheta": 0.2578109800815582,
      "pose_mae_dx": 0.04081687331199646,
      "pose_mae_dy": 0.03719117492437363,
      "pose_rmse_dtheta": 0.5693700909614563,
      "pose_rmse_dx": 0.11454319953918457,
      "pose_rmse_dy": 0.08168953657150269,
      "pose_rmse_mean": 0.25520095229148865,
      "rmse_dtheta": 0.05746830254793167,
      "rmse_dx": 0.01652347669005394,
      "rmse_dy": 0.006448285188525915,
      "rmse_mean": 0.026813354343175888,
      "rotation_flip": 0.01075268816202879,
      "sparse_tokens": 4195.0,
      "step": 7217,
      "turn_loss": 0.15970386564731598,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.33534658985318716,
      "grad_norm": 0.7798269987106323,
      "learning_rate": 3.4939491672870517e-06,
      "loss": 0.1232,
      "mae_dtheta": 0.023245684802532196,
      "mae_dx": 0.007034207694232464,
      "mae_dy": 0.0013512783916667104,
      "pose_mae_dtheta": 0.19886884093284607,
      "pose_mae_dx": 0.05740918219089508,
      "pose_mae_dy": 0.016410715878009796,
      "pose_rmse_dtheta": 0.3681612014770508,
      "pose_rmse_dx": 0.12135358154773712,
      "pose_rmse_dy": 0.05694723501801491,
      "pose_rmse_mean": 0.18215399980545044,
      "rmse_dtheta": 0.041644006967544556,
      "rmse_dx": 0.01581999659538269,
      "rmse_dy": 0.004245108924806118,
      "rmse_mean": 0.020569704473018646,
      "rotation_flip": 0.0,
      "sparse_tokens": 4841.0,
      "step": 7218,
      "turn_loss": 0.2238578051328659,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 2309.0,
      "epoch": 0.33539304961902994,
      "grad_norm": 1.039316177368164,
      "learning_rate": 3.4926884076255864e-06,
      "loss": 0.2353,
      "mae_dtheta": 0.021818872541189194,
      "mae_dx": 0.014340560883283615,
      "mae_dy": 0.006871131714433432,
      "pose_mae_dtheta": 0.14440487325191498,
      "pose_mae_dx": 0.09346123784780502,
      "pose_mae_dy": 0.07314354926347733,
      "pose_rmse_dtheta": 0.22084102034568787,
      "pose_rmse_dx": 0.19392108917236328,
      "pose_rmse_dy": 0.11184725910425186,
      "pose_rmse_mean": 0.17553645372390747,
      "rmse_dtheta": 0.032995227724313736,
      "rmse_dx": 0.02790536917746067,
      "rmse_dy": 0.010027463547885418,
      "rmse_mean": 0.023642687126994133,
      "rotation_flip": 0.0,
      "sparse_tokens": 1877.0,
      "step": 7219,
      "turn_loss": 0.3481420874595642,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.3354395093848727,
      "grad_norm": 0.4601524770259857,
      "learning_rate": 3.4914277533712324e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.0319436751306057,
      "mae_dx": 0.012897701002657413,
      "mae_dy": 0.003393627470359206,
      "pose_mae_dtheta": 0.24536097049713135,
      "pose_mae_dx": 0.10181224346160889,
      "pose_mae_dy": 0.03964526578783989,
      "pose_rmse_dtheta": 0.43991217017173767,
      "pose_rmse_dx": 0.24540063738822937,
      "pose_rmse_dy": 0.11794863641262054,
      "pose_rmse_mean": 0.26775383949279785,
      "rmse_dtheta": 0.049966733902692795,
      "rmse_dx": 0.026680640876293182,
      "rmse_dy": 0.008201105520129204,
      "rmse_mean": 0.028282826766371727,
      "rotation_flip": 0.01507882121950388,
      "sparse_tokens": 25198.0,
      "step": 7220,
      "turn_loss": 0.2557668685913086,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.3354859691507155,
      "grad_norm": 0.7062450647354126,
      "learning_rate": 3.4901672046121428e-06,
      "loss": 0.0786,
      "mae_dtheta": 0.007703396957367659,
      "mae_dx": 0.0014457490760833025,
      "mae_dy": 0.0009014935349114239,
      "pose_mae_dtheta": 0.05596023052930832,
      "pose_mae_dx": 0.01290552131831646,
      "pose_mae_dy": 0.013562481850385666,
      "pose_rmse_dtheta": 0.20047633349895477,
      "pose_rmse_dx": 0.02828722819685936,
      "pose_rmse_dy": 0.038718562573194504,
      "pose_rmse_mean": 0.08916071057319641,
      "rmse_dtheta": 0.02324429154396057,
      "rmse_dx": 0.003902649972587824,
      "rmse_dy": 0.002076444448903203,
      "rmse_mean": 0.009741129353642464,
      "rotation_flip": 0.0028794733807444572,
      "sparse_tokens": 32217.0,
      "step": 7221,
      "turn_loss": 0.05428396537899971,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.33553242891655827,
      "grad_norm": 0.6404207348823547,
      "learning_rate": 3.4889067614364714e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.011320123448967934,
      "mae_dx": 0.002136769238859415,
      "mae_dy": 0.002710985019803047,
      "pose_mae_dtheta": 0.07869801670312881,
      "pose_mae_dx": 0.029645312577486038,
      "pose_mae_dy": 0.03398839756846428,
      "pose_rmse_dtheta": 0.17958350479602814,
      "pose_rmse_dx": 0.0810592919588089,
      "pose_rmse_dy": 0.07895293831825256,
      "pose_rmse_mean": 0.11319857835769653,
      "rmse_dtheta": 0.023596376180648804,
      "rmse_dx": 0.006528064608573914,
      "rmse_dy": 0.005956978537142277,
      "rmse_mean": 0.012027139775454998,
      "rotation_flip": 0.006585788447409868,
      "sparse_tokens": 32089.0,
      "step": 7222,
      "turn_loss": 0.10709501802921295,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.33557888868240104,
      "grad_norm": 0.5322232842445374,
      "learning_rate": 3.4876464239323624e-06,
      "loss": 0.0762,
      "mae_dtheta": 0.006763631943613291,
      "mae_dx": 0.001684093731455505,
      "mae_dy": 0.0016040639020502567,
      "pose_mae_dtheta": 0.04594950005412102,
      "pose_mae_dx": 0.015277983620762825,
      "pose_mae_dy": 0.014334929175674915,
      "pose_rmse_dtheta": 0.16824105381965637,
      "pose_rmse_dx": 0.046082187443971634,
      "pose_rmse_dy": 0.03789487108588219,
      "pose_rmse_mean": 0.08407270163297653,
      "rmse_dtheta": 0.02127532847225666,
      "rmse_dx": 0.0051484559662640095,
      "rmse_dy": 0.0048067341558635235,
      "rmse_mean": 0.010410172864794731,
      "rotation_flip": 0.003550295950844884,
      "sparse_tokens": 32105.0,
      "step": 7223,
      "turn_loss": 0.05598313733935356,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3356253484482438,
      "grad_norm": 0.3063220679759979,
      "learning_rate": 3.4863861921879495e-06,
      "loss": 0.0844,
      "mae_dtheta": 0.008147156797349453,
      "mae_dx": 0.001257419353350997,
      "mae_dy": 0.0015186950331553817,
      "pose_mae_dtheta": 0.0513300783932209,
      "pose_mae_dx": 0.016084035858511925,
      "pose_mae_dy": 0.020459666848182678,
      "pose_rmse_dtheta": 0.11237762123346329,
      "pose_rmse_dx": 0.03793494403362274,
      "pose_rmse_dy": 0.0483151376247406,
      "pose_rmse_mean": 0.06620924174785614,
      "rmse_dtheta": 0.017896009609103203,
      "rmse_dx": 0.003698348067700863,
      "rmse_dy": 0.0031929300166666508,
      "rmse_mean": 0.008262429386377335,
      "rotation_flip": 0.006184067111462355,
      "sparse_tokens": 32169.0,
      "step": 7224,
      "turn_loss": 0.06600870937108994,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.3356718082140866,
      "grad_norm": 0.8067691922187805,
      "learning_rate": 3.4851260662913643e-06,
      "loss": 0.1855,
      "mae_dtheta": 0.029768269509077072,
      "mae_dx": 0.01181703433394432,
      "mae_dy": 0.0040443469770252705,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8067689538002014,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.15965270996094,
      "model/head/act_norm_mean": 108.13774632695896,
      "model/head/act_norm_min": 68.67646026611328,
      "model/head/act_over_embed": 74.31327167741796,
      "model/head/grad_frac": 0.11744626611471176,
      "model/head/grad_norm": 0.0947519987821579,
      "model/head/grad_zero_frac": 0.00011707328667398542,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6918580923507462,
      "model/head/update_ratio": 0.0016156540950760245,
      "model/head/weight_delta": 9.462986946105957,
      "model/head/weight_delta_rel": 0.1660088151693344,
      "model/head/weight_norm": 58.646217346191406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4217800199985504,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4217354269588695,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42167356610298157,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28982053375540956,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08711692690849304,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07028323411941528,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5402401194852942,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0022701590787619352,
      "model/modality_embedder.encoders.pose/weight_delta": 3.041555881500244,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.0993771106004715,
      "model/modality_embedder.encoders.pose/weight_norm": 30.959606170654297,
      "model/modality_embedder/grad_frac": 0.08711692690849304,
      "model/modality_embedder/grad_norm": 0.07028323411941528,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5402401194852942,
      "model/modality_embedder/update_ratio": 0.0022701590787619352,
      "model/modality_embedder/weight_delta": 3.041555881500244,
      "model/modality_embedder/weight_delta_rel": 0.0993771106004715,
      "model/modality_embedder/weight_norm": 30.959606170654297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.23409271240234,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.499618721866856,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.159817695617676,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.149157992563644,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06809490919113159,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.054936859756708145,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001968603814020753,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.493781328201294,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09087489545345306,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.90650749206543,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.57262420654297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.352304696754324,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.779440879821777,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.73513177747818,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07444050163030624,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06005628779530525,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002023338805884123,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1631693840026855,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10957466065883636,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.68177604675293,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.30701446533203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.970090026060177,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.046850204467773,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.846889001722044,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09046299755573273,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07298273593187332,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 7.565364649053663e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002381387632340193,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.41522216796875,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11467676609754562,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.647146224975586,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.04564666748047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.820107054015637,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.645353317260742,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.118238023465334,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.096845343708992,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07813181728124619,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0026146213058382273,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.922741174697876,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.09988542646169662,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.88265037536621,
      "model/normalizer/grad_frac": 0.3639383614063263,
      "model/normalizer/grad_norm": 0.2936141788959503,
      "model/normalizer/grad_zero_frac": 0.0001229007903020829,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0037375378888100386,
      "model/normalizer/weight_delta": 6.1763176918029785,
      "model/normalizer/weight_delta_rel": 0.07954739779233932,
      "model/normalizer/weight_norm": 78.55818176269531,
      "pose_mae_dtheta": 0.21085573732852936,
      "pose_mae_dx": 0.0864754468202591,
      "pose_mae_dy": 0.049069106578826904,
      "pose_rmse_dtheta": 0.3858763575553894,
      "pose_rmse_dx": 0.19763997197151184,
      "pose_rmse_dy": 0.126420259475708,
      "pose_rmse_mean": 0.23664554953575134,
      "rmse_dtheta": 0.047362033277750015,
      "rmse_dx": 0.024513214826583862,
      "rmse_dy": 0.008234929293394089,
      "rmse_mean": 0.02670339308679104,
      "rotation_flip": 0.01009081769734621,
      "sparse_tokens": 17014.0,
      "step": 7225,
      "turn_loss": 0.22516535222530365,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.3357182679799294,
      "grad_norm": 0.7919947504997253,
      "learning_rate": 3.483866046330725e-06,
      "loss": 0.3105,
      "mae_dtheta": 0.04584123194217682,
      "mae_dx": 0.012450756505131721,
      "mae_dy": 0.004816527012735605,
      "pose_mae_dtheta": 0.39171600341796875,
      "pose_mae_dx": 0.11176710575819016,
      "pose_mae_dy": 0.06500166654586792,
      "pose_rmse_dtheta": 0.6191518306732178,
      "pose_rmse_dx": 0.24148845672607422,
      "pose_rmse_dy": 0.1633165329694748,
      "pose_rmse_mean": 0.34131893515586853,
      "rmse_dtheta": 0.06395281851291656,
      "rmse_dx": 0.02448839135468006,
      "rmse_dy": 0.010802294127643108,
      "rmse_mean": 0.033081166446208954,
      "rotation_flip": 0.011281224898993969,
      "sparse_tokens": 20602.0,
      "step": 7226,
      "turn_loss": 0.3283192217350006,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.33576472774577215,
      "grad_norm": 0.6113494634628296,
      "learning_rate": 3.4826061323941483e-06,
      "loss": 0.0879,
      "mae_dtheta": 0.046404603868722916,
      "mae_dx": 0.012310818769037724,
      "mae_dy": 0.005032302346080542,
      "pose_mae_dtheta": 0.4204968810081482,
      "pose_mae_dx": 0.09617980569601059,
      "pose_mae_dy": 0.06522274017333984,
      "pose_rmse_dtheta": 0.697851300239563,
      "pose_rmse_dx": 0.22007501125335693,
      "pose_rmse_dy": 0.20355230569839478,
      "pose_rmse_mean": 0.37382620573043823,
      "rmse_dtheta": 0.06567811965942383,
      "rmse_dx": 0.02449881285429001,
      "rmse_dy": 0.01205288153141737,
      "rmse_mean": 0.03407660499215126,
      "rotation_flip": 0.017804155126214027,
      "sparse_tokens": 6515.0,
      "step": 7227,
      "turn_loss": 0.2810650169849396,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.33581118751161493,
      "grad_norm": 0.871377170085907,
      "learning_rate": 3.481346324569737e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.01168404333293438,
      "mae_dx": 0.0016640954418107867,
      "mae_dy": 0.002530994126573205,
      "pose_mae_dtheta": 0.07132555544376373,
      "pose_mae_dx": 0.024773921817541122,
      "pose_mae_dy": 0.029240025207400322,
      "pose_rmse_dtheta": 0.1751830279827118,
      "pose_rmse_dx": 0.060744766145944595,
      "pose_rmse_dy": 0.06449393182992935,
      "pose_rmse_mean": 0.10014057159423828,
      "rmse_dtheta": 0.024268921464681625,
      "rmse_dx": 0.0046494523994624615,
      "rmse_dy": 0.004999467637389898,
      "rmse_mean": 0.011305946856737137,
      "rotation_flip": 0.005886200349777937,
      "sparse_tokens": 32121.0,
      "step": 7228,
      "turn_loss": 0.09321220219135284,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.3358576472774577,
      "grad_norm": 0.4563457667827606,
      "learning_rate": 3.4800866229455936e-06,
      "loss": 0.1031,
      "mae_dtheta": 0.04302310571074486,
      "mae_dx": 0.00855132844299078,
      "mae_dy": 0.0022068596445024014,
      "pose_mae_dtheta": 0.34393584728240967,
      "pose_mae_dx": 0.07042587548494339,
      "pose_mae_dy": 0.01910959742963314,
      "pose_rmse_dtheta": 0.5659120082855225,
      "pose_rmse_dx": 0.17390796542167664,
      "pose_rmse_dy": 0.04859815165400505,
      "pose_rmse_mean": 0.2628060579299927,
      "rmse_dtheta": 0.061612870544195175,
      "rmse_dx": 0.01940368115901947,
      "rmse_dy": 0.005131868179887533,
      "rmse_mean": 0.02871614322066307,
      "rotation_flip": 0.020209580659866333,
      "sparse_tokens": 18334.0,
      "step": 7229,
      "turn_loss": 0.2802206575870514,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.3359041070433005,
      "grad_norm": 0.8230541348457336,
      "learning_rate": 3.4788270276098086e-06,
      "loss": 0.1213,
      "mae_dtheta": 0.027702584862709045,
      "mae_dx": 0.008553298190236092,
      "mae_dy": 0.0037675441708415747,
      "pose_mae_dtheta": 0.20944634079933167,
      "pose_mae_dx": 0.06643268465995789,
      "pose_mae_dy": 0.046723004430532455,
      "pose_rmse_dtheta": 0.42430874705314636,
      "pose_rmse_dx": 0.182437002658844,
      "pose_rmse_dy": 0.12170650064945221,
      "pose_rmse_mean": 0.24281740188598633,
      "rmse_dtheta": 0.047572970390319824,
      "rmse_dx": 0.021465415135025978,
      "rmse_dy": 0.00883296225219965,
      "rmse_mean": 0.02595711499452591,
      "rotation_flip": 0.014450866729021072,
      "sparse_tokens": 15257.0,
      "step": 7230,
      "turn_loss": 0.2269478738307953,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 20065.0,
      "epoch": 0.33595056680914326,
      "grad_norm": 0.4901139438152313,
      "learning_rate": 3.477567538650466e-06,
      "loss": 0.1409,
      "mae_dtheta": 0.028063377365469933,
      "mae_dx": 0.01141425035893917,
      "mae_dy": 0.0071188719011843204,
      "pose_mae_dtheta": 0.21473482251167297,
      "pose_mae_dx": 0.09078531712293625,
      "pose_mae_dy": 0.11003809422254562,
      "pose_rmse_dtheta": 0.3587947189807892,
      "pose_rmse_dx": 0.19733615219593048,
      "pose_rmse_dy": 0.2179258167743683,
      "pose_rmse_mean": 0.2580189108848572,
      "rmse_dtheta": 0.04253801703453064,
      "rmse_dx": 0.023657875135540962,
      "rmse_dy": 0.01253677997738123,
      "rmse_mean": 0.02624422311782837,
      "rotation_flip": 0.007751937955617905,
      "sparse_tokens": 17577.0,
      "step": 7231,
      "turn_loss": 0.25313693284988403,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.33599702657498604,
      "grad_norm": 0.6293953657150269,
      "learning_rate": 3.4763081561556423e-06,
      "loss": 0.1374,
      "mae_dtheta": 0.03607124090194702,
      "mae_dx": 0.01349701825529337,
      "mae_dy": 0.006634897086769342,
      "pose_mae_dtheta": 0.2814132571220398,
      "pose_mae_dx": 0.11499553918838501,
      "pose_mae_dy": 0.08971498161554337,
      "pose_rmse_dtheta": 0.5075576305389404,
      "pose_rmse_dx": 0.23736260831356049,
      "pose_rmse_dy": 0.2091209888458252,
      "pose_rmse_mean": 0.3180137574672699,
      "rmse_dtheta": 0.05471480265259743,
      "rmse_dx": 0.026167575269937515,
      "rmse_dy": 0.013423013500869274,
      "rmse_mean": 0.03143513202667236,
      "rotation_flip": 0.021021021530032158,
      "sparse_tokens": 16843.0,
      "step": 7232,
      "turn_loss": 0.33412250876426697,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.33604348634082887,
      "grad_norm": 0.645926296710968,
      "learning_rate": 3.475048880213407e-06,
      "loss": 0.097,
      "mae_dtheta": 0.024438995867967606,
      "mae_dx": 0.01696176454424858,
      "mae_dy": 0.0071382904425263405,
      "pose_mae_dtheta": 0.12775550782680511,
      "pose_mae_dx": 0.15460360050201416,
      "pose_mae_dy": 0.11483790725469589,
      "pose_rmse_dtheta": 0.18606555461883545,
      "pose_rmse_dx": 0.312402606010437,
      "pose_rmse_dy": 0.1995382010936737,
      "pose_rmse_mean": 0.23266880214214325,
      "rmse_dtheta": 0.034006159752607346,
      "rmse_dx": 0.03349161520600319,
      "rmse_dy": 0.009601632133126259,
      "rmse_mean": 0.025699801743030548,
      "rotation_flip": 0.021739130839705467,
      "sparse_tokens": 2281.0,
      "step": 7233,
      "turn_loss": 0.269842267036438,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.33608994610667164,
      "grad_norm": 0.6393600106239319,
      "learning_rate": 3.4737897109118215e-06,
      "loss": 0.166,
      "mae_dtheta": 0.011548337526619434,
      "mae_dx": 0.0018898710841313004,
      "mae_dy": 0.0029406475368887186,
      "pose_mae_dtheta": 0.08773349970579147,
      "pose_mae_dx": 0.02389347553253174,
      "pose_mae_dy": 0.03132518008351326,
      "pose_rmse_dtheta": 0.22900241613388062,
      "pose_rmse_dx": 0.05779008939862251,
      "pose_rmse_dy": 0.0722610130906105,
      "pose_rmse_mean": 0.11968450993299484,
      "rmse_dtheta": 0.024787766858935356,
      "rmse_dx": 0.005076720844954252,
      "rmse_dy": 0.006536281201988459,
      "rmse_mean": 0.012133589945733547,
      "rotation_flip": 0.004038772080093622,
      "sparse_tokens": 32089.0,
      "step": 7234,
      "turn_loss": 0.08199553936719894,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3361364058725144,
      "grad_norm": 0.8684749603271484,
      "learning_rate": 3.472530648338942e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.009087557904422283,
      "mae_dx": 0.0025018686428666115,
      "mae_dy": 0.002673676935955882,
      "pose_mae_dtheta": 0.06274158507585526,
      "pose_mae_dx": 0.027413956820964813,
      "pose_mae_dy": 0.025826986879110336,
      "pose_rmse_dtheta": 0.1463373452425003,
      "pose_rmse_dx": 0.07817298173904419,
      "pose_rmse_dy": 0.060976166278123856,
      "pose_rmse_mean": 0.09516216814517975,
      "rmse_dtheta": 0.02041204646229744,
      "rmse_dx": 0.008951766416430473,
      "rmse_dy": 0.006271949503570795,
      "rmse_mean": 0.011878587305545807,
      "rotation_flip": 0.004562043584883213,
      "sparse_tokens": 32073.0,
      "step": 7235,
      "turn_loss": 0.08609259128570557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1986.0,
      "epoch": 0.3361828656383572,
      "grad_norm": 0.42842260003089905,
      "learning_rate": 3.471271692582812e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.04444193094968796,
      "mae_dx": 0.024673225358128548,
      "mae_dy": 0.013661024160683155,
      "pose_mae_dtheta": 0.42192643880844116,
      "pose_mae_dx": 0.14737454056739807,
      "pose_mae_dy": 0.16931380331516266,
      "pose_rmse_dtheta": 0.6537615656852722,
      "pose_rmse_dx": 0.23203562200069427,
      "pose_rmse_dy": 0.25363287329673767,
      "pose_rmse_mean": 0.37981003522872925,
      "rmse_dtheta": 0.0614858977496624,
      "rmse_dx": 0.03848441317677498,
      "rmse_dy": 0.017584864050149918,
      "rmse_mean": 0.0391850583255291,
      "rotation_flip": 0.009523809887468815,
      "sparse_tokens": 1763.0,
      "step": 7236,
      "turn_loss": 0.3039509654045105,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.3362293254042,
      "grad_norm": 0.5963262319564819,
      "learning_rate": 3.470012843731476e-06,
      "loss": 0.1603,
      "mae_dtheta": 0.02213232032954693,
      "mae_dx": 0.004816026892513037,
      "mae_dy": 0.00373546639457345,
      "pose_mae_dtheta": 0.1616542786359787,
      "pose_mae_dx": 0.038983117789030075,
      "pose_mae_dy": 0.05618048831820488,
      "pose_rmse_dtheta": 0.3953283727169037,
      "pose_rmse_dx": 0.0960555374622345,
      "pose_rmse_dy": 0.14318683743476868,
      "pose_rmse_mean": 0.21152357757091522,
      "rmse_dtheta": 0.0442047081887722,
      "rmse_dx": 0.01414411049336195,
      "rmse_dy": 0.009263618849217892,
      "rmse_mean": 0.022537481039762497,
      "rotation_flip": 0.02140672691166401,
      "sparse_tokens": 8598.0,
      "step": 7237,
      "turn_loss": 0.10707131773233414,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.33627578517004275,
      "grad_norm": 0.5692431330680847,
      "learning_rate": 3.46875410187296e-06,
      "loss": 0.0892,
      "mae_dtheta": 0.01007130742073059,
      "mae_dx": 0.0014869365841150284,
      "mae_dy": 0.0004287754709366709,
      "pose_mae_dtheta": 0.06891661137342453,
      "pose_mae_dx": 0.011918485164642334,
      "pose_mae_dy": 0.005729006137698889,
      "pose_rmse_dtheta": 0.24224087595939636,
      "pose_rmse_dx": 0.027315380051732063,
      "pose_rmse_dy": 0.021196037530899048,
      "pose_rmse_mean": 0.09691743552684784,
      "rmse_dtheta": 0.03140142187476158,
      "rmse_dx": 0.004354272037744522,
      "rmse_dy": 0.001179839950054884,
      "rmse_mean": 0.01231184508651495,
      "rotation_flip": 0.0005858230870217085,
      "sparse_tokens": 32185.0,
      "step": 7238,
      "turn_loss": 0.06787220388650894,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.33632224493588553,
      "grad_norm": 0.5622885227203369,
      "learning_rate": 3.467495467095294e-06,
      "loss": 0.1549,
      "mae_dtheta": 0.03994543477892876,
      "mae_dx": 0.014750505797564983,
      "mae_dy": 0.00816383957862854,
      "pose_mae_dtheta": 0.3260866701602936,
      "pose_mae_dx": 0.11299215257167816,
      "pose_mae_dy": 0.07853793352842331,
      "pose_rmse_dtheta": 0.5131049752235413,
      "pose_rmse_dx": 0.22818540036678314,
      "pose_rmse_dy": 0.17816951870918274,
      "pose_rmse_mean": 0.30648666620254517,
      "rmse_dtheta": 0.05787616968154907,
      "rmse_dx": 0.02641577646136284,
      "rmse_dy": 0.01738382689654827,
      "rmse_mean": 0.03389192745089531,
      "rotation_flip": 0.019837692379951477,
      "sparse_tokens": 17058.0,
      "step": 7239,
      "turn_loss": 0.37744635343551636,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.3363687047017283,
      "grad_norm": 0.6537871360778809,
      "learning_rate": 3.466236939486491e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.03673611581325531,
      "mae_dx": 0.011229491792619228,
      "mae_dy": 0.0029031482990831137,
      "pose_mae_dtheta": 0.29385092854499817,
      "pose_mae_dx": 0.0862932950258255,
      "pose_mae_dy": 0.037098199129104614,
      "pose_rmse_dtheta": 0.47993725538253784,
      "pose_rmse_dx": 0.19727154076099396,
      "pose_rmse_dy": 0.10191028565168381,
      "pose_rmse_mean": 0.25970637798309326,
      "rmse_dtheta": 0.053996942937374115,
      "rmse_dx": 0.023380478844046593,
      "rmse_dy": 0.006288992241024971,
      "rmse_mean": 0.02788880467414856,
      "rotation_flip": 0.01581508480012417,
      "sparse_tokens": 12547.0,
      "step": 7240,
      "turn_loss": 0.2592770755290985,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.3364151644675711,
      "grad_norm": 0.8199635148048401,
      "learning_rate": 3.4649785191345613e-06,
      "loss": 0.2214,
      "mae_dtheta": 0.049279797822237015,
      "mae_dx": 0.007430869620293379,
      "mae_dy": 0.0018590184627100825,
      "pose_mae_dtheta": 0.3859279155731201,
      "pose_mae_dx": 0.06354118138551712,
      "pose_mae_dy": 0.021296916529536247,
      "pose_rmse_dtheta": 0.5728374123573303,
      "pose_rmse_dx": 0.13674257695674896,
      "pose_rmse_dy": 0.052273500710725784,
      "pose_rmse_mean": 0.25395119190216064,
      "rmse_dtheta": 0.06630390137434006,
      "rmse_dx": 0.015538262203335762,
      "rmse_dy": 0.004474299028515816,
      "rmse_mean": 0.028772152960300446,
      "rotation_flip": 0.019718309864401817,
      "sparse_tokens": 5596.0,
      "step": 7241,
      "turn_loss": 0.2641778588294983,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.33646162423341386,
      "grad_norm": 0.43242719769477844,
      "learning_rate": 3.46372020612751e-06,
      "loss": 0.1183,
      "mae_dtheta": 0.012388868257403374,
      "mae_dx": 0.002323250751942396,
      "mae_dy": 0.0023918000515550375,
      "pose_mae_dtheta": 0.08692038804292679,
      "pose_mae_dx": 0.022821221500635147,
      "pose_mae_dy": 0.023002151399850845,
      "pose_rmse_dtheta": 0.23913316428661346,
      "pose_rmse_dx": 0.06931895762681961,
      "pose_rmse_dy": 0.0605948381125927,
      "pose_rmse_mean": 0.12301565706729889,
      "rmse_dtheta": 0.029088716953992844,
      "rmse_dx": 0.007327111903578043,
      "rmse_dy": 0.006534956861287355,
      "rmse_mean": 0.014316929504275322,
      "rotation_flip": 0.006156552117317915,
      "sparse_tokens": 32121.0,
      "step": 7242,
      "turn_loss": 0.10164999961853027,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.33650808399925664,
      "grad_norm": 0.645592212677002,
      "learning_rate": 3.4624620005533273e-06,
      "loss": 0.0978,
      "mae_dtheta": 0.007720303256064653,
      "mae_dx": 0.0015008309856057167,
      "mae_dy": 0.0018394439248368144,
      "pose_mae_dtheta": 0.05607561022043228,
      "pose_mae_dx": 0.01648605801165104,
      "pose_mae_dy": 0.024118954315781593,
      "pose_rmse_dtheta": 0.15962864458560944,
      "pose_rmse_dx": 0.05740814656019211,
      "pose_rmse_dy": 0.058538682758808136,
      "pose_rmse_mean": 0.09185849130153656,
      "rmse_dtheta": 0.018554648384451866,
      "rmse_dx": 0.005082183983176947,
      "rmse_dy": 0.0045431796461343765,
      "rmse_mean": 0.009393338114023209,
      "rotation_flip": 0.008167432621121407,
      "sparse_tokens": 32057.0,
      "step": 7243,
      "turn_loss": 0.06647520512342453,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.3365545437650994,
      "grad_norm": 0.5724812746047974,
      "learning_rate": 3.4612039025000044e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.04136677831411362,
      "mae_dx": 0.010243863798677921,
      "mae_dy": 0.004699745215475559,
      "pose_mae_dtheta": 0.3408293128013611,
      "pose_mae_dx": 0.08736880868673325,
      "pose_mae_dy": 0.03159954398870468,
      "pose_rmse_dtheta": 0.5890418291091919,
      "pose_rmse_dx": 0.1737096905708313,
      "pose_rmse_dy": 0.07646387070417404,
      "pose_rmse_mean": 0.27973848581314087,
      "rmse_dtheta": 0.06021566316485405,
      "rmse_dx": 0.019517309963703156,
      "rmse_dy": 0.01287529245018959,
      "rmse_mean": 0.030869420617818832,
      "rotation_flip": 0.00977995153516531,
      "sparse_tokens": 6706.0,
      "step": 7244,
      "turn_loss": 0.33194097876548767,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.3366010035309422,
      "grad_norm": 0.4959472417831421,
      "learning_rate": 3.459945912055516e-06,
      "loss": 0.1222,
      "mae_dtheta": 0.025702280923724174,
      "mae_dx": 0.014973437413573265,
      "mae_dy": 0.003656035289168358,
      "pose_mae_dtheta": 0.17309872806072235,
      "pose_mae_dx": 0.13876011967658997,
      "pose_mae_dy": 0.05868091806769371,
      "pose_rmse_dtheta": 0.3848912715911865,
      "pose_rmse_dx": 0.3052911162376404,
      "pose_rmse_dy": 0.14271098375320435,
      "pose_rmse_mean": 0.27763113379478455,
      "rmse_dtheta": 0.04518374055624008,
      "rmse_dx": 0.03055248036980629,
      "rmse_dy": 0.008110110647976398,
      "rmse_mean": 0.027948779985308647,
      "rotation_flip": 0.015325670130550861,
      "sparse_tokens": 5766.0,
      "step": 7245,
      "turn_loss": 0.22322499752044678,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.33664746329678497,
      "grad_norm": 0.5971139073371887,
      "learning_rate": 3.458688029307839e-06,
      "loss": 0.1731,
      "mae_dtheta": 0.02483232133090496,
      "mae_dx": 0.010248936712741852,
      "mae_dy": 0.003911985084414482,
      "pose_mae_dtheta": 0.20966754853725433,
      "pose_mae_dx": 0.08494695276021957,
      "pose_mae_dy": 0.06392157077789307,
      "pose_rmse_dtheta": 0.36647680401802063,
      "pose_rmse_dx": 0.22236551344394684,
      "pose_rmse_dy": 0.14418278634548187,
      "pose_rmse_mean": 0.24434171617031097,
      "rmse_dtheta": 0.038649432361125946,
      "rmse_dx": 0.023583663627505302,
      "rmse_dy": 0.007331057917326689,
      "rmse_mean": 0.02318805269896984,
      "rotation_flip": 0.009661835618317127,
      "sparse_tokens": 11215.0,
      "step": 7246,
      "turn_loss": 0.18550100922584534,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.33669392306262774,
      "grad_norm": 0.6062601804733276,
      "learning_rate": 3.4574302543449334e-06,
      "loss": 0.0876,
      "mae_dtheta": 0.017174972221255302,
      "mae_dx": 0.00826836284250021,
      "mae_dy": 0.0023069221060723066,
      "pose_mae_dtheta": 0.10391946136951447,
      "pose_mae_dx": 0.05534827709197998,
      "pose_mae_dy": 0.028493791818618774,
      "pose_rmse_dtheta": 0.17855341732501984,
      "pose_rmse_dx": 0.16524994373321533,
      "pose_rmse_dy": 0.05988489091396332,
      "pose_rmse_mean": 0.13456276059150696,
      "rmse_dtheta": 0.028805401176214218,
      "rmse_dx": 0.021218154579401016,
      "rmse_dy": 0.004059349652379751,
      "rmse_mean": 0.018027635291218758,
      "rotation_flip": 0.011876484379172325,
      "sparse_tokens": 8620.0,
      "step": 7247,
      "turn_loss": 0.131617933511734,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3367403828284705,
      "grad_norm": 0.41953492164611816,
      "learning_rate": 3.4561725872547585e-06,
      "loss": 0.1326,
      "mae_dtheta": 0.010775843635201454,
      "mae_dx": 0.0020526123698800802,
      "mae_dy": 0.002123621292412281,
      "pose_mae_dtheta": 0.07334904372692108,
      "pose_mae_dx": 0.024903535842895508,
      "pose_mae_dy": 0.02905949205160141,
      "pose_rmse_dtheta": 0.19211409986019135,
      "pose_rmse_dx": 0.06493813544511795,
      "pose_rmse_dy": 0.0657261312007904,
      "pose_rmse_mean": 0.10759279131889343,
      "rmse_dtheta": 0.024036355316638947,
      "rmse_dx": 0.0068025849759578705,
      "rmse_dy": 0.0049462756142020226,
      "rmse_mean": 0.011928405612707138,
      "rotation_flip": 0.005777777638286352,
      "sparse_tokens": 32041.0,
      "step": 7248,
      "turn_loss": 0.11065126955509186,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.33678684259431335,
      "grad_norm": 0.4574872851371765,
      "learning_rate": 3.4549150281252635e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.015330938622355461,
      "mae_dx": 0.0017779446206986904,
      "mae_dy": 0.003350289771333337,
      "pose_mae_dtheta": 0.10730530321598053,
      "pose_mae_dx": 0.028941577300429344,
      "pose_mae_dy": 0.04115375876426697,
      "pose_rmse_dtheta": 0.23593294620513916,
      "pose_rmse_dx": 0.06431183964014053,
      "pose_rmse_dy": 0.08614487200975418,
      "pose_rmse_mean": 0.1287965476512909,
      "rmse_dtheta": 0.03012062795460224,
      "rmse_dx": 0.004247122909873724,
      "rmse_dy": 0.006135188043117523,
      "rmse_mean": 0.013500980101525784,
      "rotation_flip": 0.007895640097558498,
      "sparse_tokens": 32105.0,
      "step": 7249,
      "turn_loss": 0.12900391221046448,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.33683330236015613,
      "grad_norm": 0.557331383228302,
      "learning_rate": 3.4536575770443903e-06,
      "loss": 0.1003,
      "mae_dtheta": 0.024450231343507767,
      "mae_dx": 0.009596620686352253,
      "mae_dy": 0.004217518959194422,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.557331383228302,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.97613525390625,
      "model/head/act_norm_mean": 113.9968047560307,
      "model/head/act_norm_min": 60.13948059082031,
      "model/head/act_over_embed": 78.3396714832453,
      "model/head/grad_frac": 0.10370312631130219,
      "model/head/grad_norm": 0.05779700726270676,
      "model/head/grad_zero_frac": 0.0001906803372548893,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6860265899122807,
      "model/head/update_ratio": 0.0009854906238615513,
      "model/head/weight_delta": 9.473017692565918,
      "model/head/weight_delta_rel": 0.16618478298187256,
      "model/head/weight_norm": 58.647953033447266,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4218764007091522,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42181695740798425,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42177003622055054,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2898765622433413,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1074959859251976,
      "model/modality_embedder.encoders.pose/grad_norm": 0.059910885989665985,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5218884698275862,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019350973889231682,
      "model/modality_embedder.encoders.pose/weight_delta": 3.043623924255371,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.099444679915905,
      "model/modality_embedder.encoders.pose/weight_norm": 30.960140228271484,
      "model/modality_embedder/grad_frac": 0.1074959859251976,
      "model/modality_embedder/grad_norm": 0.059910885989665985,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5218884698275862,
      "model/modality_embedder/update_ratio": 0.0019350973889231682,
      "model/modality_embedder/weight_delta": 3.043623924255371,
      "model/modality_embedder/weight_delta_rel": 0.099444679915905,
      "model/modality_embedder/weight_norm": 30.960140228271484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.45513153076172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.001583820662766,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.165163040161133,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.49411310792749,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06950654834508896,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.038738179951906204,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001388091710396111,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.4974589347839355,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09100890904664993,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.907506942749023,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.73764038085938,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.85365975703147,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.66312026977539,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.07966766866066,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07333994656801224,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.040874652564525604,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013770473888143897,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.167567729949951,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10972702503204346,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.682823181152344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.15957641601562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.515757710247843,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.325075149536133,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.221876942917156,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07922253012657166,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04415320232510567,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001440635183826089,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.42061448097229,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11485783010721207,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.648426055908203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.77172088623047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.340151594263435,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.943767547607422,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.475617500257318,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09459060430526733,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05271831154823303,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017641396261751652,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.927011728286743,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10003136843442917,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.883298873901367,
      "model/normalizer/grad_frac": 0.2969551384449005,
      "model/normalizer/grad_norm": 0.1655024141073227,
      "model/normalizer/grad_zero_frac": 0.0001737155398586765,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002106711268424988,
      "model/normalizer/weight_delta": 6.185513973236084,
      "model/normalizer/weight_delta_rel": 0.07966583967208862,
      "model/normalizer/weight_norm": 78.55960845947266,
      "pose_mae_dtheta": 0.18468447029590607,
      "pose_mae_dx": 0.07941243052482605,
      "pose_mae_dy": 0.04796241596341133,
      "pose_rmse_dtheta": 0.32982391119003296,
      "pose_rmse_dx": 0.1773196905851364,
      "pose_rmse_dy": 0.11068188399076462,
      "pose_rmse_mean": 0.205941841006279,
      "rmse_dtheta": 0.039910197257995605,
      "rmse_dx": 0.020038319751620293,
      "rmse_dy": 0.009650451131165028,
      "rmse_mean": 0.0231996588408947,
      "rotation_flip": 0.011848341673612595,
      "sparse_tokens": 15699.0,
      "step": 7250,
      "turn_loss": 0.17486867308616638,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3368797621259989,
      "grad_norm": 0.4502379894256592,
      "learning_rate": 3.452400234100072e-06,
      "loss": 0.1326,
      "mae_dtheta": 0.011448999866843224,
      "mae_dx": 0.0027585311327129602,
      "mae_dy": 0.0040595256723463535,
      "pose_mae_dtheta": 0.07189352810382843,
      "pose_mae_dx": 0.03050289675593376,
      "pose_mae_dy": 0.037426285445690155,
      "pose_rmse_dtheta": 0.14154040813446045,
      "pose_rmse_dx": 0.07366067171096802,
      "pose_rmse_dy": 0.08463086932897568,
      "pose_rmse_mean": 0.09994398802518845,
      "rmse_dtheta": 0.02297772467136383,
      "rmse_dx": 0.007890102453529835,
      "rmse_dy": 0.00980777945369482,
      "rmse_mean": 0.01355853583663702,
      "rotation_flip": 0.008103130385279655,
      "sparse_tokens": 32057.0,
      "step": 7251,
      "turn_loss": 0.11190957576036453,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3369262218918417,
      "grad_norm": 0.5550787448883057,
      "learning_rate": 3.4511429993802357e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.010841896757483482,
      "mae_dx": 0.00322025828063488,
      "mae_dy": 0.0037764457520097494,
      "pose_mae_dtheta": 0.07299675792455673,
      "pose_mae_dx": 0.030191920697689056,
      "pose_mae_dy": 0.026044968515634537,
      "pose_rmse_dtheta": 0.15594597160816193,
      "pose_rmse_dx": 0.07316904515028,
      "pose_rmse_dy": 0.05946292355656624,
      "pose_rmse_mean": 0.09619265049695969,
      "rmse_dtheta": 0.024583250284194946,
      "rmse_dx": 0.008419143036007881,
      "rmse_dy": 0.008232505060732365,
      "rmse_mean": 0.013744965195655823,
      "rotation_flip": 0.005765534937381744,
      "sparse_tokens": 32201.0,
      "step": 7252,
      "turn_loss": 0.1253155618906021,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.33697268165768446,
      "grad_norm": 0.5602139830589294,
      "learning_rate": 3.4498858729728006e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.009608141146600246,
      "mae_dx": 0.0013786117779091,
      "mae_dy": 0.0022008316591382027,
      "pose_mae_dtheta": 0.05698879808187485,
      "pose_mae_dx": 0.019655324518680573,
      "pose_mae_dy": 0.023264750838279724,
      "pose_rmse_dtheta": 0.14939871430397034,
      "pose_rmse_dx": 0.04869641363620758,
      "pose_rmse_dy": 0.0504368357360363,
      "pose_rmse_mean": 0.08284398913383484,
      "rmse_dtheta": 0.02228403463959694,
      "rmse_dx": 0.003944368567317724,
      "rmse_dy": 0.004607836715877056,
      "rmse_mean": 0.010278746485710144,
      "rotation_flip": 0.00626398203894496,
      "sparse_tokens": 32057.0,
      "step": 7253,
      "turn_loss": 0.0827365294098854,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.33701914142352724,
      "grad_norm": 0.634279191493988,
      "learning_rate": 3.4486288549656804e-06,
      "loss": 0.2002,
      "mae_dtheta": 0.011864768341183662,
      "mae_dx": 0.0022827093489468098,
      "mae_dy": 0.003480948507785797,
      "pose_mae_dtheta": 0.07508408278226852,
      "pose_mae_dx": 0.032922402024269104,
      "pose_mae_dy": 0.03564475104212761,
      "pose_rmse_dtheta": 0.14585541188716888,
      "pose_rmse_dx": 0.07657773792743683,
      "pose_rmse_dy": 0.07353071868419647,
      "pose_rmse_mean": 0.09865462779998779,
      "rmse_dtheta": 0.021773748099803925,
      "rmse_dx": 0.0058214119635522366,
      "rmse_dy": 0.007417381275445223,
      "rmse_mean": 0.011670848354697227,
      "rotation_flip": 0.0026220912113785744,
      "sparse_tokens": 32153.0,
      "step": 7254,
      "turn_loss": 0.10904250293970108,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.33706560118937,
      "grad_norm": 0.33908066153526306,
      "learning_rate": 3.4473719454467747e-06,
      "loss": 0.0753,
      "mae_dtheta": 0.008680122904479504,
      "mae_dx": 0.0015774641651660204,
      "mae_dy": 0.00021926913177594543,
      "pose_mae_dtheta": 0.06272706389427185,
      "pose_mae_dx": 0.011787831783294678,
      "pose_mae_dy": 0.0030097090639173985,
      "pose_rmse_dtheta": 0.2583957016468048,
      "pose_rmse_dx": 0.028818858787417412,
      "pose_rmse_dy": 0.0059495167806744576,
      "pose_rmse_mean": 0.09772136062383652,
      "rmse_dtheta": 0.03134164586663246,
      "rmse_dx": 0.004251281730830669,
      "rmse_dy": 0.00046037568245083094,
      "rmse_mean": 0.012017767876386642,
      "rotation_flip": 0.0006253908504731953,
      "sparse_tokens": 32217.0,
      "step": 7255,
      "turn_loss": 0.04363936558365822,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.3371120609552128,
      "grad_norm": 0.5649449229240417,
      "learning_rate": 3.4461151445039844e-06,
      "loss": 0.1562,
      "mae_dtheta": 0.04165803641080856,
      "mae_dx": 0.0120231406763196,
      "mae_dy": 0.007525302469730377,
      "pose_mae_dtheta": 0.2997656464576721,
      "pose_mae_dx": 0.0875222235918045,
      "pose_mae_dy": 0.07535648345947266,
      "pose_rmse_dtheta": 0.518280029296875,
      "pose_rmse_dx": 0.1953004151582718,
      "pose_rmse_dy": 0.1902848482131958,
      "pose_rmse_mean": 0.3012884259223938,
      "rmse_dtheta": 0.06210885941982269,
      "rmse_dx": 0.02397473342716694,
      "rmse_dy": 0.014785170555114746,
      "rmse_mean": 0.033622920513153076,
      "rotation_flip": 0.007839721627533436,
      "sparse_tokens": 17908.0,
      "step": 7256,
      "turn_loss": 0.3347521722316742,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.33715852072105557,
      "grad_norm": 0.7468585968017578,
      "learning_rate": 3.4448584522251938e-06,
      "loss": 0.1428,
      "mae_dtheta": 0.033664193004369736,
      "mae_dx": 0.010965199209749699,
      "mae_dy": 0.006178340408951044,
      "pose_mae_dtheta": 0.26052218675613403,
      "pose_mae_dx": 0.09352000057697296,
      "pose_mae_dy": 0.09082105755805969,
      "pose_rmse_dtheta": 0.46115121245384216,
      "pose_rmse_dx": 0.23135079443454742,
      "pose_rmse_dy": 0.20200932025909424,
      "pose_rmse_mean": 0.29817044734954834,
      "rmse_dtheta": 0.05052918940782547,
      "rmse_dx": 0.02460063062608242,
      "rmse_dy": 0.01121626328676939,
      "rmse_mean": 0.028782028704881668,
      "rotation_flip": 0.02500000037252903,
      "sparse_tokens": 12261.0,
      "step": 7257,
      "turn_loss": 0.2554950416088104,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.33720498048689834,
      "grad_norm": 0.5197625160217285,
      "learning_rate": 3.4436018686982884e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.010854567401111126,
      "mae_dx": 0.00222980510443449,
      "mae_dy": 0.0027796232607215643,
      "pose_mae_dtheta": 0.07850231975317001,
      "pose_mae_dx": 0.027350202202796936,
      "pose_mae_dy": 0.028977105394005775,
      "pose_rmse_dtheta": 0.2106163054704666,
      "pose_rmse_dx": 0.07590578496456146,
      "pose_rmse_dy": 0.07508520781993866,
      "pose_rmse_mean": 0.12053577601909637,
      "rmse_dtheta": 0.024313511326909065,
      "rmse_dx": 0.006682774052023888,
      "rmse_dy": 0.0073402575217187405,
      "rmse_mean": 0.012778847478330135,
      "rotation_flip": 0.007089240942150354,
      "sparse_tokens": 32105.0,
      "step": 7258,
      "turn_loss": 0.09344420582056046,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22649.0,
      "epoch": 0.3372514402527411,
      "grad_norm": 0.3815942704677582,
      "learning_rate": 3.4423453940111382e-06,
      "loss": 0.1132,
      "mae_dtheta": 0.03300308808684349,
      "mae_dx": 0.015240170992910862,
      "mae_dy": 0.00525326794013381,
      "pose_mae_dtheta": 0.273820161819458,
      "pose_mae_dx": 0.12507347762584686,
      "pose_mae_dy": 0.05419977009296417,
      "pose_rmse_dtheta": 0.46752357482910156,
      "pose_rmse_dx": 0.27582573890686035,
      "pose_rmse_dy": 0.1306203156709671,
      "pose_rmse_mean": 0.2913232147693634,
      "rmse_dtheta": 0.049785494804382324,
      "rmse_dx": 0.028631117194890976,
      "rmse_dy": 0.011807151138782501,
      "rmse_mean": 0.0300745889544487,
      "rotation_flip": 0.01109989918768406,
      "sparse_tokens": 17564.0,
      "step": 7259,
      "turn_loss": 0.26406624913215637,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3372979000185839,
      "grad_norm": 0.3316894471645355,
      "learning_rate": 3.4410890282516103e-06,
      "loss": 0.0743,
      "mae_dtheta": 0.009339972399175167,
      "mae_dx": 0.001776132732629776,
      "mae_dy": 0.0026006759144365788,
      "pose_mae_dtheta": 0.06767559796571732,
      "pose_mae_dx": 0.02380736730992794,
      "pose_mae_dy": 0.02563866786658764,
      "pose_rmse_dtheta": 0.18041495978832245,
      "pose_rmse_dx": 0.07213571667671204,
      "pose_rmse_dy": 0.05548220872879028,
      "pose_rmse_mean": 0.10267762839794159,
      "rmse_dtheta": 0.021961219608783722,
      "rmse_dx": 0.005969635676592588,
      "rmse_dy": 0.007100466638803482,
      "rmse_mean": 0.011677107773721218,
      "rotation_flip": 0.00426621176302433,
      "sparse_tokens": 32057.0,
      "step": 7260,
      "turn_loss": 0.08578609675168991,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28785.0,
      "epoch": 0.3373443597844267,
      "grad_norm": 0.5080047845840454,
      "learning_rate": 3.439832771507565e-06,
      "loss": 0.0947,
      "mae_dtheta": 0.02815864607691765,
      "mae_dx": 0.013439884409308434,
      "mae_dy": 0.003614679677411914,
      "pose_mae_dtheta": 0.24435648322105408,
      "pose_mae_dx": 0.10156334936618805,
      "pose_mae_dy": 0.046729687601327896,
      "pose_rmse_dtheta": 0.44960010051727295,
      "pose_rmse_dx": 0.23111850023269653,
      "pose_rmse_dy": 0.12561902403831482,
      "pose_rmse_mean": 0.2687792181968689,
      "rmse_dtheta": 0.04599299281835556,
      "rmse_dx": 0.026211539283394814,
      "rmse_dy": 0.007607338484376669,
      "rmse_mean": 0.026603957638144493,
      "rotation_flip": 0.0050293379463255405,
      "sparse_tokens": 21975.0,
      "step": 7261,
      "turn_loss": 0.2249225676059723,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.33739081955026945,
      "grad_norm": 0.37528201937675476,
      "learning_rate": 3.43857662386685e-06,
      "loss": 0.0882,
      "mae_dtheta": 0.02626698836684227,
      "mae_dx": 0.004970051348209381,
      "mae_dy": 0.004035702906548977,
      "pose_mae_dtheta": 0.16626299917697906,
      "pose_mae_dx": 0.0437224842607975,
      "pose_mae_dy": 0.04936430603265762,
      "pose_rmse_dtheta": 0.3560613989830017,
      "pose_rmse_dx": 0.12040022015571594,
      "pose_rmse_dy": 0.14622145891189575,
      "pose_rmse_mean": 0.20756101608276367,
      "rmse_dtheta": 0.045584965497255325,
      "rmse_dx": 0.013844710774719715,
      "rmse_dy": 0.009835013188421726,
      "rmse_mean": 0.023088229820132256,
      "rotation_flip": 0.015170670114457607,
      "sparse_tokens": 13709.0,
      "step": 7262,
      "turn_loss": 0.19564205408096313,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.3374372793161122,
      "grad_norm": 0.7037368416786194,
      "learning_rate": 3.437320585417312e-06,
      "loss": 0.1933,
      "mae_dtheta": 0.03499762341380119,
      "mae_dx": 0.010477667674422264,
      "mae_dy": 0.010436112061142921,
      "pose_mae_dtheta": 0.2991380989551544,
      "pose_mae_dx": 0.07404163479804993,
      "pose_mae_dy": 0.13325947523117065,
      "pose_rmse_dtheta": 0.5437465310096741,
      "pose_rmse_dx": 0.159706711769104,
      "pose_rmse_dy": 0.2593923807144165,
      "pose_rmse_mean": 0.3209485411643982,
      "rmse_dtheta": 0.05293295159935951,
      "rmse_dx": 0.022313958033919334,
      "rmse_dy": 0.017474519088864326,
      "rmse_mean": 0.030907142907381058,
      "rotation_flip": 0.01479289960116148,
      "sparse_tokens": 6496.0,
      "step": 7263,
      "turn_loss": 0.32047587633132935,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.337483739081955,
      "grad_norm": 0.32887837290763855,
      "learning_rate": 3.4360646562467815e-06,
      "loss": 0.071,
      "mae_dtheta": 0.010252372361719608,
      "mae_dx": 0.001141104381531477,
      "mae_dy": 0.0017699074232950807,
      "pose_mae_dtheta": 0.06721176207065582,
      "pose_mae_dx": 0.01306089386343956,
      "pose_mae_dy": 0.020117349922657013,
      "pose_rmse_dtheta": 0.20674043893814087,
      "pose_rmse_dx": 0.03585781157016754,
      "pose_rmse_dy": 0.04604721441864967,
      "pose_rmse_mean": 0.096215158700943,
      "rmse_dtheta": 0.025681426748633385,
      "rmse_dx": 0.004211870022118092,
      "rmse_dy": 0.00450787553563714,
      "rmse_mean": 0.011467058211565018,
      "rotation_flip": 0.0031152646988630295,
      "sparse_tokens": 32057.0,
      "step": 7264,
      "turn_loss": 0.07334034144878387,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3375301988477978,
      "grad_norm": 0.586090624332428,
      "learning_rate": 3.434808836443091e-06,
      "loss": 0.1563,
      "mae_dtheta": 0.011936372146010399,
      "mae_dx": 0.0018529644003137946,
      "mae_dy": 0.0036009550094604492,
      "pose_mae_dtheta": 0.0766017735004425,
      "pose_mae_dx": 0.030773421749472618,
      "pose_mae_dy": 0.03576734662055969,
      "pose_rmse_dtheta": 0.1572088897228241,
      "pose_rmse_dx": 0.07682425528764725,
      "pose_rmse_dy": 0.07669476419687271,
      "pose_rmse_mean": 0.10357596725225449,
      "rmse_dtheta": 0.022315312176942825,
      "rmse_dx": 0.0046923416666686535,
      "rmse_dy": 0.007149405311793089,
      "rmse_mean": 0.011385686695575714,
      "rotation_flip": 0.006732927169650793,
      "sparse_tokens": 32105.0,
      "step": 7265,
      "turn_loss": 0.10079297423362732,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.3375766586136406,
      "grad_norm": 0.8594304919242859,
      "learning_rate": 3.4335531260940567e-06,
      "loss": 0.2709,
      "mae_dtheta": 0.03685283288359642,
      "mae_dx": 0.008356189355254173,
      "mae_dy": 0.0027754632756114006,
      "pose_mae_dtheta": 0.28220444917678833,
      "pose_mae_dx": 0.06686903536319733,
      "pose_mae_dy": 0.032841406762599945,
      "pose_rmse_dtheta": 0.49493929743766785,
      "pose_rmse_dx": 0.17327959835529327,
      "pose_rmse_dy": 0.08094462752342224,
      "pose_rmse_mean": 0.24972116947174072,
      "rmse_dtheta": 0.0558590441942215,
      "rmse_dx": 0.020435377955436707,
      "rmse_dy": 0.005815798882395029,
      "rmse_mean": 0.027370072901248932,
      "rotation_flip": 0.010733452625572681,
      "sparse_tokens": 18421.0,
      "step": 7266,
      "turn_loss": 0.2553628385066986,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.3376231183794834,
      "grad_norm": 1.5992215871810913,
      "learning_rate": 3.432297525287495e-06,
      "loss": 0.3332,
      "mae_dtheta": 0.027752267196774483,
      "mae_dx": 0.010827559977769852,
      "mae_dy": 0.007483576890081167,
      "pose_mae_dtheta": 0.2142484486103058,
      "pose_mae_dx": 0.10009261220693588,
      "pose_mae_dy": 0.09621181339025497,
      "pose_rmse_dtheta": 0.4355723261833191,
      "pose_rmse_dx": 0.24255597591400146,
      "pose_rmse_dy": 0.24791976809501648,
      "pose_rmse_mean": 0.3086826801300049,
      "rmse_dtheta": 0.04743615537881851,
      "rmse_dx": 0.023159757256507874,
      "rmse_dy": 0.017730774357914925,
      "rmse_mean": 0.029442228376865387,
      "rotation_flip": 0.0055555556900799274,
      "sparse_tokens": 6838.0,
      "step": 7267,
      "turn_loss": 0.24498100578784943,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.33766957814532617,
      "grad_norm": 0.40026453137397766,
      "learning_rate": 3.431042034111207e-06,
      "loss": 0.0633,
      "mae_dtheta": 0.006250187288969755,
      "mae_dx": 0.0008767757681198418,
      "mae_dy": 0.0010005302028730512,
      "pose_mae_dtheta": 0.043244898319244385,
      "pose_mae_dx": 0.01055428758263588,
      "pose_mae_dy": 0.016602562740445137,
      "pose_rmse_dtheta": 0.13547372817993164,
      "pose_rmse_dx": 0.027388451620936394,
      "pose_rmse_dy": 0.051964156329631805,
      "pose_rmse_mean": 0.0716087818145752,
      "rmse_dtheta": 0.017877211794257164,
      "rmse_dx": 0.003070774022489786,
      "rmse_dy": 0.002371811540797353,
      "rmse_mean": 0.007773266173899174,
      "rotation_flip": 0.005504587199538946,
      "sparse_tokens": 32057.0,
      "step": 7268,
      "turn_loss": 0.04432017728686333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.33771603791116894,
      "grad_norm": 0.4028259515762329,
      "learning_rate": 3.4297866526529934e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.01223485916852951,
      "mae_dx": 0.0024874319788068533,
      "mae_dy": 0.0029250422958284616,
      "pose_mae_dtheta": 0.08170533180236816,
      "pose_mae_dx": 0.023707175627350807,
      "pose_mae_dy": 0.027717994526028633,
      "pose_rmse_dtheta": 0.21250535547733307,
      "pose_rmse_dx": 0.07022720575332642,
      "pose_rmse_dy": 0.07321500778198242,
      "pose_rmse_mean": 0.1186491847038269,
      "rmse_dtheta": 0.026839589700102806,
      "rmse_dx": 0.00863471906632185,
      "rmse_dy": 0.00839550606906414,
      "rmse_mean": 0.014623272232711315,
      "rotation_flip": 0.0021459227427840233,
      "sparse_tokens": 32073.0,
      "step": 7269,
      "turn_loss": 0.09796898066997528,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.3377624976770117,
      "grad_norm": 0.8169397115707397,
      "learning_rate": 3.4285313810006405e-06,
      "loss": 0.2005,
      "mae_dtheta": 0.045680418610572815,
      "mae_dx": 0.015082458034157753,
      "mae_dy": 0.00849930290132761,
      "pose_mae_dtheta": 0.37664517760276794,
      "pose_mae_dx": 0.12388261407613754,
      "pose_mae_dy": 0.0926860123872757,
      "pose_rmse_dtheta": 0.5969131588935852,
      "pose_rmse_dx": 0.22894524037837982,
      "pose_rmse_dy": 0.23319582641124725,
      "pose_rmse_mean": 0.3530181050300598,
      "rmse_dtheta": 0.06247291713953018,
      "rmse_dx": 0.02588820457458496,
      "rmse_dy": 0.017965201288461685,
      "rmse_mean": 0.035442110151052475,
      "rotation_flip": 0.01278409082442522,
      "sparse_tokens": 12041.0,
      "step": 7270,
      "turn_loss": 0.3648533821105957,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3378089574428545,
      "grad_norm": 0.5891337990760803,
      "learning_rate": 3.427276219241933e-06,
      "loss": 0.1162,
      "mae_dtheta": 0.009858195669949055,
      "mae_dx": 0.0021271046716719866,
      "mae_dy": 0.0019187740981578827,
      "pose_mae_dtheta": 0.06857781857252121,
      "pose_mae_dx": 0.018380742520093918,
      "pose_mae_dy": 0.022575674578547478,
      "pose_rmse_dtheta": 0.18060150742530823,
      "pose_rmse_dx": 0.04433915391564369,
      "pose_rmse_dy": 0.052359357476234436,
      "pose_rmse_mean": 0.09243333339691162,
      "rmse_dtheta": 0.023595916107296944,
      "rmse_dx": 0.007152989972382784,
      "rmse_dy": 0.005141094326972961,
      "rmse_mean": 0.011963333003222942,
      "rotation_flip": 0.004136029630899429,
      "sparse_tokens": 32105.0,
      "step": 7271,
      "turn_loss": 0.08162180334329605,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.3378554172086973,
      "grad_norm": 0.5225986838340759,
      "learning_rate": 3.4260211674646413e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.02645900845527649,
      "mae_dx": 0.008331854827702045,
      "mae_dy": 0.0049693388864398,
      "pose_mae_dtheta": 0.17429257929325104,
      "pose_mae_dx": 0.053114231675863266,
      "pose_mae_dy": 0.046225063502788544,
      "pose_rmse_dtheta": 0.3330167829990387,
      "pose_rmse_dx": 0.14362794160842896,
      "pose_rmse_dy": 0.10837434232234955,
      "pose_rmse_mean": 0.1950063556432724,
      "rmse_dtheta": 0.04387328028678894,
      "rmse_dx": 0.020708616822957993,
      "rmse_dy": 0.009126726537942886,
      "rmse_mean": 0.024569541215896606,
      "rotation_flip": 0.008389261551201344,
      "sparse_tokens": 9679.0,
      "step": 7272,
      "turn_loss": 0.2172713279724121,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.33790187697454005,
      "grad_norm": 0.5185823440551758,
      "learning_rate": 3.4247662257565372e-06,
      "loss": 0.1131,
      "mae_dtheta": 0.03059576079249382,
      "mae_dx": 0.00975197646766901,
      "mae_dy": 0.007692230399698019,
      "pose_mae_dtheta": 0.23651495575904846,
      "pose_mae_dx": 0.07146322727203369,
      "pose_mae_dy": 0.07324089854955673,
      "pose_rmse_dtheta": 0.42412957549095154,
      "pose_rmse_dx": 0.1497841775417328,
      "pose_rmse_dy": 0.19066402316093445,
      "pose_rmse_mean": 0.2548592686653137,
      "rmse_dtheta": 0.04742460697889328,
      "rmse_dx": 0.019771775230765343,
      "rmse_dy": 0.01666773296892643,
      "rmse_mean": 0.02795470505952835,
      "rotation_flip": 0.011435831896960735,
      "sparse_tokens": 13052.0,
      "step": 7273,
      "turn_loss": 0.29526185989379883,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.3379483367403828,
      "grad_norm": 0.7336508631706238,
      "learning_rate": 3.4235113942053737e-06,
      "loss": 0.137,
      "mae_dtheta": 0.03379805386066437,
      "mae_dx": 0.00671052560210228,
      "mae_dy": 0.005853782873600721,
      "pose_mae_dtheta": 0.27037888765335083,
      "pose_mae_dx": 0.06274604797363281,
      "pose_mae_dy": 0.06553579866886139,
      "pose_rmse_dtheta": 0.5135635733604431,
      "pose_rmse_dx": 0.13236412405967712,
      "pose_rmse_dy": 0.11965568363666534,
      "pose_rmse_mean": 0.25519445538520813,
      "rmse_dtheta": 0.05340205878019333,
      "rmse_dx": 0.0165869127959013,
      "rmse_dy": 0.010101544670760632,
      "rmse_mean": 0.026696838438510895,
      "rotation_flip": 0.00804289523512125,
      "sparse_tokens": 6236.0,
      "step": 7274,
      "turn_loss": 0.23069456219673157,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.3379947965062256,
      "grad_norm": 0.71668541431427,
      "learning_rate": 3.422256672898907e-06,
      "loss": 0.1602,
      "mae_dtheta": 0.026826130226254463,
      "mae_dx": 0.009159584529697895,
      "mae_dy": 0.0032586287707090378,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.71668541431427,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.95675659179688,
      "model/head/act_norm_mean": 113.99065290178571,
      "model/head/act_norm_min": 80.85921478271484,
      "model/head/act_over_embed": 78.33544387141357,
      "model/head/grad_frac": 0.10924515873193741,
      "model/head/grad_norm": 0.07829441130161285,
      "model/head/grad_zero_frac": 0.00018147945229429752,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6856631324404762,
      "model/head/update_ratio": 0.0013349488144740462,
      "model/head/weight_delta": 9.481475830078125,
      "model/head/weight_delta_rel": 0.1663331687450409,
      "model/head/weight_norm": 58.649749755859375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42185479402542114,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42179089923237645,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42173758149147034,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2898586548211031,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09259255975484848,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0663597360253334,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5471475290697675,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0021434035152196884,
      "model/modality_embedder.encoders.pose/weight_delta": 3.047945022583008,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09958586096763611,
      "model/modality_embedder.encoders.pose/weight_norm": 30.959983825683594,
      "model/modality_embedder/grad_frac": 0.09259255975484848,
      "model/modality_embedder/grad_norm": 0.0663597360253334,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5471475290697675,
      "model/modality_embedder/update_ratio": 0.0021434035152196884,
      "model/modality_embedder/weight_delta": 3.047945022583008,
      "model/modality_embedder/weight_delta_rel": 0.09958586096763611,
      "model/modality_embedder/weight_norm": 30.959983825683594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.51683044433594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.066423965419503,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.10448169708252,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.538671862447316,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07974020391702652,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05714863911271095,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020477361977100372,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.500575542449951,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09112247824668884,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.908205032348633,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 82.76018524169922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.898800666099774,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.722119331359863,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.11068892398825,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08001689612865448,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05734694376587868,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019319322891533375,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.17205810546875,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.10988257080316544,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.68372344970703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.07779693603516,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.523275108654573,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.248435020446777,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.227042969481253,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07435078173875809,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0532861202955246,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017385560786351562,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.425861358642578,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11503400653600693,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.649641036987305,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.52885437011719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.34725174792139,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.181344032287598,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.48049679232375,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07425420731306076,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05321690812706947,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017807723488658667,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.931500196456909,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10018476843833923,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.884172439575195,
      "model/normalizer/grad_frac": 0.2879229784011841,
      "model/normalizer/grad_norm": 0.2063501924276352,
      "model/normalizer/grad_zero_frac": 0.00022453030396718532,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0026266323402523994,
      "model/normalizer/weight_delta": 6.194454193115234,
      "model/normalizer/weight_delta_rel": 0.07978098094463348,
      "model/normalizer/weight_norm": 78.56074523925781,
      "pose_mae_dtheta": 0.19374188780784607,
      "pose_mae_dx": 0.07960338145494461,
      "pose_mae_dy": 0.038655877113342285,
      "pose_rmse_dtheta": 0.35145366191864014,
      "pose_rmse_dx": 0.18347758054733276,
      "pose_rmse_dy": 0.08924239873886108,
      "pose_rmse_mean": 0.20805788040161133,
      "rmse_dtheta": 0.04504874721169472,
      "rmse_dx": 0.020057888701558113,
      "rmse_dy": 0.007107230834662914,
      "rmse_mean": 0.024071289226412773,
      "rotation_flip": 0.015306122601032257,
      "sparse_tokens": 10665.0,
      "step": 7275,
      "turn_loss": 0.1852879822254181,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 34064.0,
      "epoch": 0.3380412562720684,
      "grad_norm": 0.6272622346878052,
      "learning_rate": 3.4210020619248762e-06,
      "loss": 0.1927,
      "mae_dtheta": 0.030319420620799065,
      "mae_dx": 0.01016820129007101,
      "mae_dy": 0.006835525389760733,
      "pose_mae_dtheta": 0.22076518833637238,
      "pose_mae_dx": 0.07899753004312515,
      "pose_mae_dy": 0.074785977602005,
      "pose_rmse_dtheta": 0.38785627484321594,
      "pose_rmse_dx": 0.1793413758277893,
      "pose_rmse_dy": 0.17409466207027435,
      "pose_rmse_mean": 0.2470974624156952,
      "rmse_dtheta": 0.04690834507346153,
      "rmse_dx": 0.021601960062980652,
      "rmse_dy": 0.012854075990617275,
      "rmse_mean": 0.027121461927890778,
      "rotation_flip": 0.012500000186264515,
      "sparse_tokens": 27307.0,
      "step": 7276,
      "turn_loss": 0.28126779198646545,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.33808771603791116,
      "grad_norm": 0.4528859555721283,
      "learning_rate": 3.41974756137102e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.04558200389146805,
      "mae_dx": 0.012693047523498535,
      "mae_dy": 0.008820271119475365,
      "pose_mae_dtheta": 0.3634316027164459,
      "pose_mae_dx": 0.12787847220897675,
      "pose_mae_dy": 0.14325538277626038,
      "pose_rmse_dtheta": 0.6120635867118835,
      "pose_rmse_dx": 0.26980355381965637,
      "pose_rmse_dy": 0.2811441421508789,
      "pose_rmse_mean": 0.38767045736312866,
      "rmse_dtheta": 0.06393007189035416,
      "rmse_dx": 0.02733735367655754,
      "rmse_dy": 0.014061345718801022,
      "rmse_mean": 0.035109590739011765,
      "rotation_flip": 0.006818181835114956,
      "sparse_tokens": 8327.0,
      "step": 7277,
      "turn_loss": 0.33361509442329407,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.33813417580375393,
      "grad_norm": 0.607491672039032,
      "learning_rate": 3.4184931713250636e-06,
      "loss": 0.0977,
      "mae_dtheta": 0.01087156217545271,
      "mae_dx": 0.0016507271211594343,
      "mae_dy": 0.002501628128811717,
      "pose_mae_dtheta": 0.07107953727245331,
      "pose_mae_dx": 0.02122066728770733,
      "pose_mae_dy": 0.02788194827735424,
      "pose_rmse_dtheta": 0.1804124414920807,
      "pose_rmse_dx": 0.061692140996456146,
      "pose_rmse_dy": 0.06513069570064545,
      "pose_rmse_mean": 0.10241176933050156,
      "rmse_dtheta": 0.02443568967282772,
      "rmse_dx": 0.004617326892912388,
      "rmse_dy": 0.00574509846046567,
      "rmse_mean": 0.011599372141063213,
      "rotation_flip": 0.004542013630270958,
      "sparse_tokens": 32121.0,
      "step": 7278,
      "turn_loss": 0.09436866641044617,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 41214.0,
      "epoch": 0.3381806355695967,
      "grad_norm": 0.6861552596092224,
      "learning_rate": 3.4172388918747278e-06,
      "loss": 0.2101,
      "mae_dtheta": 0.038440048694610596,
      "mae_dx": 0.012907109223306179,
      "mae_dy": 0.00503132538869977,
      "pose_mae_dtheta": 0.302096962928772,
      "pose_mae_dx": 0.10625957697629929,
      "pose_mae_dy": 0.050012409687042236,
      "pose_rmse_dtheta": 0.5293626189231873,
      "pose_rmse_dx": 0.22414721548557281,
      "pose_rmse_dy": 0.12442313879728317,
      "pose_rmse_mean": 0.29264432191848755,
      "rmse_dtheta": 0.05821877717971802,
      "rmse_dx": 0.025209752842783928,
      "rmse_dy": 0.010466469451785088,
      "rmse_mean": 0.03129833564162254,
      "rotation_flip": 0.011997913010418415,
      "sparse_tokens": 30114.0,
      "step": 7279,
      "turn_loss": 0.29364171624183655,
      "turns": 127.0,
      "turns_per_sample": 127.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3382270953354395,
      "grad_norm": 0.4694337546825409,
      "learning_rate": 3.4159847231077288e-06,
      "loss": 0.0839,
      "mae_dtheta": 0.00988327618688345,
      "mae_dx": 0.0013244831934571266,
      "mae_dy": 0.0020557681564241648,
      "pose_mae_dtheta": 0.061734654009342194,
      "pose_mae_dx": 0.014334151521325111,
      "pose_mae_dy": 0.022826218977570534,
      "pose_rmse_dtheta": 0.1825326383113861,
      "pose_rmse_dx": 0.05151723325252533,
      "pose_rmse_dy": 0.05582306906580925,
      "pose_rmse_mean": 0.09662431478500366,
      "rmse_dtheta": 0.023934505879878998,
      "rmse_dx": 0.005253966897726059,
      "rmse_dy": 0.005404253955930471,
      "rmse_mean": 0.01153090875595808,
      "rotation_flip": 0.005499999970197678,
      "sparse_tokens": 32073.0,
      "step": 7280,
      "turn_loss": 0.06447955220937729,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.33827355510128226,
      "grad_norm": 0.44810450077056885,
      "learning_rate": 3.4147306651117663e-06,
      "loss": 0.113,
      "mae_dtheta": 0.04262237623333931,
      "mae_dx": 0.009478827938437462,
      "mae_dy": 0.0047623394057154655,
      "pose_mae_dtheta": 0.35734817385673523,
      "pose_mae_dx": 0.06901878863573074,
      "pose_mae_dy": 0.049148645251989365,
      "pose_rmse_dtheta": 0.5738233923912048,
      "pose_rmse_dx": 0.16090480983257294,
      "pose_rmse_dy": 0.14908376336097717,
      "pose_rmse_mean": 0.29460400342941284,
      "rmse_dtheta": 0.06084363907575607,
      "rmse_dx": 0.020555157214403152,
      "rmse_dy": 0.010507922619581223,
      "rmse_mean": 0.03063557669520378,
      "rotation_flip": 0.015432098880410194,
      "sparse_tokens": 11470.0,
      "step": 7281,
      "turn_loss": 0.3780151903629303,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 26931.0,
      "epoch": 0.3383200148671251,
      "grad_norm": 0.6122889518737793,
      "learning_rate": 3.4134767179745404e-06,
      "loss": 0.1512,
      "mae_dtheta": 0.02978457696735859,
      "mae_dx": 0.008555658161640167,
      "mae_dy": 0.004222556483000517,
      "pose_mae_dtheta": 0.20910149812698364,
      "pose_mae_dx": 0.06411692500114441,
      "pose_mae_dy": 0.050074197351932526,
      "pose_rmse_dtheta": 0.4047597646713257,
      "pose_rmse_dx": 0.15404650568962097,
      "pose_rmse_dy": 0.1183510422706604,
      "pose_rmse_mean": 0.2257191240787506,
      "rmse_dtheta": 0.047558143734931946,
      "rmse_dx": 0.019911589100956917,
      "rmse_dy": 0.008212928660213947,
      "rmse_mean": 0.025227554142475128,
      "rotation_flip": 0.011885895393788815,
      "sparse_tokens": 20221.0,
      "step": 7282,
      "turn_loss": 0.2135382890701294,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.3383664746329679,
      "grad_norm": 0.5509096384048462,
      "learning_rate": 3.4122228817837376e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.03628472983837128,
      "mae_dx": 0.009588094428181648,
      "mae_dy": 0.005318425130099058,
      "pose_mae_dtheta": 0.2716158330440521,
      "pose_mae_dx": 0.07164914160966873,
      "pose_mae_dy": 0.06359049677848816,
      "pose_rmse_dtheta": 0.4870404303073883,
      "pose_rmse_dx": 0.16515034437179565,
      "pose_rmse_dy": 0.14156118035316467,
      "pose_rmse_mean": 0.2645840048789978,
      "rmse_dtheta": 0.05348360911011696,
      "rmse_dx": 0.021251490339636803,
      "rmse_dy": 0.009625631384551525,
      "rmse_mean": 0.028120242059230804,
      "rotation_flip": 0.010893246158957481,
      "sparse_tokens": 7297.0,
      "step": 7283,
      "turn_loss": 0.22743836045265198,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 24266.0,
      "epoch": 0.33841293439881065,
      "grad_norm": 0.5160691142082214,
      "learning_rate": 3.410969156627043e-06,
      "loss": 0.1821,
      "mae_dtheta": 0.035793714225292206,
      "mae_dx": 0.013741238042712212,
      "mae_dy": 0.003662349656224251,
      "pose_mae_dtheta": 0.28907835483551025,
      "pose_mae_dx": 0.11270665377378464,
      "pose_mae_dy": 0.0417366586625576,
      "pose_rmse_dtheta": 0.5076954960823059,
      "pose_rmse_dx": 0.24275287985801697,
      "pose_rmse_dy": 0.1148865818977356,
      "pose_rmse_mean": 0.28844499588012695,
      "rmse_dtheta": 0.05443476513028145,
      "rmse_dx": 0.026570124551653862,
      "rmse_dy": 0.007834338583052158,
      "rmse_mean": 0.029613075777888298,
      "rotation_flip": 0.016333937644958496,
      "sparse_tokens": 17157.0,
      "step": 7284,
      "turn_loss": 0.236741840839386,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.3384593941646534,
      "grad_norm": 0.6162636876106262,
      "learning_rate": 3.4097155425921256e-06,
      "loss": 0.1418,
      "mae_dtheta": 0.03324178606271744,
      "mae_dx": 0.006610688287764788,
      "mae_dy": 0.00290463725104928,
      "pose_mae_dtheta": 0.24636034667491913,
      "pose_mae_dx": 0.05047221481800079,
      "pose_mae_dy": 0.03582996875047684,
      "pose_rmse_dtheta": 0.4529474973678589,
      "pose_rmse_dx": 0.10146690160036087,
      "pose_rmse_dy": 0.0863228514790535,
      "pose_rmse_mean": 0.21357908844947815,
      "rmse_dtheta": 0.05222711339592934,
      "rmse_dx": 0.014840370044112206,
      "rmse_dy": 0.006771298125386238,
      "rmse_mean": 0.024612925946712494,
      "rotation_flip": 0.011834319680929184,
      "sparse_tokens": 17885.0,
      "step": 7285,
      "turn_loss": 0.23498225212097168,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.3385058539304962,
      "grad_norm": 0.783350944519043,
      "learning_rate": 3.4084620397666556e-06,
      "loss": 0.1811,
      "mae_dtheta": 0.0309646874666214,
      "mae_dx": 0.012135710567235947,
      "mae_dy": 0.00916227512061596,
      "pose_mae_dtheta": 0.19688460230827332,
      "pose_mae_dx": 0.09700386226177216,
      "pose_mae_dy": 0.14298710227012634,
      "pose_rmse_dtheta": 0.3144208490848541,
      "pose_rmse_dx": 0.18564893305301666,
      "pose_rmse_dy": 0.26138973236083984,
      "pose_rmse_mean": 0.25381985306739807,
      "rmse_dtheta": 0.04272095486521721,
      "rmse_dx": 0.024190837517380714,
      "rmse_dy": 0.013583189807832241,
      "rmse_mean": 0.02683166228234768,
      "rotation_flip": 0.01689189113676548,
      "sparse_tokens": 5009.0,
      "step": 7286,
      "turn_loss": 0.2510142922401428,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.338552313696339,
      "grad_norm": 0.49240195751190186,
      "learning_rate": 3.407208648238289e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.03104272298514843,
      "mae_dx": 0.005756232421845198,
      "mae_dy": 0.0047027673572301865,
      "pose_mae_dtheta": 0.2624005377292633,
      "pose_mae_dx": 0.0468335784971714,
      "pose_mae_dy": 0.050908878445625305,
      "pose_rmse_dtheta": 0.5157129168510437,
      "pose_rmse_dx": 0.13467149436473846,
      "pose_rmse_dy": 0.11128885298967361,
      "pose_rmse_mean": 0.25389111042022705,
      "rmse_dtheta": 0.050443384796381,
      "rmse_dx": 0.015957392752170563,
      "rmse_dy": 0.008857187815010548,
      "rmse_mean": 0.025085991248488426,
      "rotation_flip": 0.008130080997943878,
      "sparse_tokens": 7820.0,
      "step": 7287,
      "turn_loss": 0.1982499212026596,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 18508.0,
      "epoch": 0.33859877346218176,
      "grad_norm": 0.482480525970459,
      "learning_rate": 3.4059553680946767e-06,
      "loss": 0.1058,
      "mae_dtheta": 0.03553193435072899,
      "mae_dx": 0.01106300763785839,
      "mae_dy": 0.004894327372312546,
      "pose_mae_dtheta": 0.2503773868083954,
      "pose_mae_dx": 0.08975494652986526,
      "pose_mae_dy": 0.05141593515872955,
      "pose_rmse_dtheta": 0.4673768877983093,
      "pose_rmse_dx": 0.2286778837442398,
      "pose_rmse_dy": 0.11271565407514572,
      "pose_rmse_mean": 0.2695901393890381,
      "rmse_dtheta": 0.05347622558474541,
      "rmse_dx": 0.02469341643154621,
      "rmse_dy": 0.008995951153337955,
      "rmse_mean": 0.029055198654532433,
      "rotation_flip": 0.014023732393980026,
      "sparse_tokens": 15646.0,
      "step": 7288,
      "turn_loss": 0.24621598422527313,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.33864523322802453,
      "grad_norm": 0.4506041407585144,
      "learning_rate": 3.404702199423461e-06,
      "loss": 0.0858,
      "mae_dtheta": 0.010397604666650295,
      "mae_dx": 0.0016263045836240053,
      "mae_dy": 0.0021051850635558367,
      "pose_mae_dtheta": 0.07082664221525192,
      "pose_mae_dx": 0.022211601957678795,
      "pose_mae_dy": 0.02311452478170395,
      "pose_rmse_dtheta": 0.2066163569688797,
      "pose_rmse_dx": 0.05485110357403755,
      "pose_rmse_dy": 0.05259779095649719,
      "pose_rmse_mean": 0.10468842089176178,
      "rmse_dtheta": 0.024314338341355324,
      "rmse_dx": 0.004887858405709267,
      "rmse_dy": 0.004499776288866997,
      "rmse_mean": 0.011233991011977196,
      "rotation_flip": 0.0035932445898652077,
      "sparse_tokens": 32121.0,
      "step": 7289,
      "turn_loss": 0.07285266369581223,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.3386916929938673,
      "grad_norm": 0.7013553380966187,
      "learning_rate": 3.4034491423122765e-06,
      "loss": 0.1813,
      "mae_dtheta": 0.03398764505982399,
      "mae_dx": 0.00930869486182928,
      "mae_dy": 0.006659144069999456,
      "pose_mae_dtheta": 0.2812515199184418,
      "pose_mae_dx": 0.09086613357067108,
      "pose_mae_dy": 0.09557043015956879,
      "pose_rmse_dtheta": 0.5169480443000793,
      "pose_rmse_dx": 0.19849635660648346,
      "pose_rmse_dy": 0.18992877006530762,
      "pose_rmse_mean": 0.30179107189178467,
      "rmse_dtheta": 0.05167292803525925,
      "rmse_dx": 0.020424889400601387,
      "rmse_dy": 0.011489246040582657,
      "rmse_mean": 0.02786235511302948,
      "rotation_flip": 0.012165450491011143,
      "sparse_tokens": 7463.0,
      "step": 7290,
      "turn_loss": 0.26564645767211914,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3387381527597101,
      "grad_norm": 0.6334006786346436,
      "learning_rate": 3.402196196848751e-06,
      "loss": 0.1118,
      "mae_dtheta": 0.00945963989943266,
      "mae_dx": 0.0012883698800578713,
      "mae_dy": 0.0020197073463350534,
      "pose_mae_dtheta": 0.05812624841928482,
      "pose_mae_dx": 0.018025364726781845,
      "pose_mae_dy": 0.025223873555660248,
      "pose_rmse_dtheta": 0.14802441000938416,
      "pose_rmse_dx": 0.040925558656454086,
      "pose_rmse_dy": 0.053370945155620575,
      "pose_rmse_mean": 0.08077364414930344,
      "rmse_dtheta": 0.02098320610821247,
      "rmse_dx": 0.003924520220607519,
      "rmse_dy": 0.003903690492734313,
      "rmse_mean": 0.009603805840015411,
      "rotation_flip": 0.009490333497524261,
      "sparse_tokens": 32105.0,
      "step": 7291,
      "turn_loss": 0.08039682358503342,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.33878461252555286,
      "grad_norm": 0.4895937144756317,
      "learning_rate": 3.4009433631205025e-06,
      "loss": 0.0711,
      "mae_dtheta": 0.009471646510064602,
      "mae_dx": 0.0018981283064931631,
      "mae_dy": 0.0020779503975063562,
      "pose_mae_dtheta": 0.06563156843185425,
      "pose_mae_dx": 0.022664831951260567,
      "pose_mae_dy": 0.02766372263431549,
      "pose_rmse_dtheta": 0.17242538928985596,
      "pose_rmse_dx": 0.06301625072956085,
      "pose_rmse_dy": 0.0710347592830658,
      "pose_rmse_mean": 0.1021588072180748,
      "rmse_dtheta": 0.02226608246564865,
      "rmse_dx": 0.006739940959960222,
      "rmse_dy": 0.00515715079382062,
      "rmse_mean": 0.011387724429368973,
      "rotation_flip": 0.0012892135418951511,
      "sparse_tokens": 32073.0,
      "step": 7292,
      "turn_loss": 0.08336562663316727,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.33883107229139564,
      "grad_norm": 0.415860116481781,
      "learning_rate": 3.399690641215142e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.026573801413178444,
      "mae_dx": 0.009340038523077965,
      "mae_dy": 0.008297047577798367,
      "pose_mae_dtheta": 0.19997122883796692,
      "pose_mae_dx": 0.06150400638580322,
      "pose_mae_dy": 0.0938100665807724,
      "pose_rmse_dtheta": 0.32952404022216797,
      "pose_rmse_dx": 0.15438464283943176,
      "pose_rmse_dy": 0.20878851413726807,
      "pose_rmse_mean": 0.23089906573295593,
      "rmse_dtheta": 0.04069149121642113,
      "rmse_dx": 0.02079852484166622,
      "rmse_dy": 0.016719290986657143,
      "rmse_mean": 0.026069767773151398,
      "rotation_flip": 0.01953125,
      "sparse_tokens": 11291.0,
      "step": 7293,
      "turn_loss": 0.24150201678276062,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3388775320572384,
      "grad_norm": 0.4307636618614197,
      "learning_rate": 3.3984380312202764e-06,
      "loss": 0.1137,
      "mae_dtheta": 0.009773626923561096,
      "mae_dx": 0.0014087061863392591,
      "mae_dy": 0.0026104405988007784,
      "pose_mae_dtheta": 0.054350368678569794,
      "pose_mae_dx": 0.022828245535492897,
      "pose_mae_dy": 0.027004925534129143,
      "pose_rmse_dtheta": 0.10943545401096344,
      "pose_rmse_dx": 0.054779406636953354,
      "pose_rmse_dy": 0.05527115985751152,
      "pose_rmse_mean": 0.0731620118021965,
      "rmse_dtheta": 0.018661709502339363,
      "rmse_dx": 0.003744348417967558,
      "rmse_dy": 0.005552215967327356,
      "rmse_mean": 0.009319424629211426,
      "rotation_flip": 0.006062647327780724,
      "sparse_tokens": 32089.0,
      "step": 7294,
      "turn_loss": 0.08557036519050598,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.3389239918230812,
      "grad_norm": 0.3160133957862854,
      "learning_rate": 3.3971855332234966e-06,
      "loss": 0.0823,
      "mae_dtheta": 0.032852865755558014,
      "mae_dx": 0.0025827218778431416,
      "mae_dy": 0.010556457564234734,
      "pose_mae_dtheta": 0.20777109265327454,
      "pose_mae_dx": 0.055441468954086304,
      "pose_mae_dy": 0.15081630647182465,
      "pose_rmse_dtheta": 0.36013299226760864,
      "pose_rmse_dx": 0.1055181622505188,
      "pose_rmse_dy": 0.29692739248275757,
      "pose_rmse_mean": 0.25419285893440247,
      "rmse_dtheta": 0.045240405946969986,
      "rmse_dx": 0.004880711901932955,
      "rmse_dy": 0.01464060042053461,
      "rmse_mean": 0.02158724144101143,
      "rotation_flip": 0.014150943607091904,
      "sparse_tokens": 4168.0,
      "step": 7295,
      "turn_loss": 0.29368525743484497,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.33897045158892397,
      "grad_norm": 0.3399198353290558,
      "learning_rate": 3.3959331473123947e-06,
      "loss": 0.0795,
      "mae_dtheta": 0.006751394364982843,
      "mae_dx": 0.0011672136606648564,
      "mae_dy": 0.000721102929674089,
      "pose_mae_dtheta": 0.04520052671432495,
      "pose_mae_dx": 0.010937117971479893,
      "pose_mae_dy": 0.010290760546922684,
      "pose_rmse_dtheta": 0.18872720003128052,
      "pose_rmse_dx": 0.02738584391772747,
      "pose_rmse_dy": 0.028856098651885986,
      "pose_rmse_mean": 0.08165638148784637,
      "rmse_dtheta": 0.024673936888575554,
      "rmse_dx": 0.0039027915336191654,
      "rmse_dy": 0.001892761094495654,
      "rmse_mean": 0.010156496427953243,
      "rotation_flip": 0.0012368584284558892,
      "sparse_tokens": 32121.0,
      "step": 7296,
      "turn_loss": 0.050036344677209854,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.33901691135476675,
      "grad_norm": 0.5378947854042053,
      "learning_rate": 3.394680873574546e-06,
      "loss": 0.1395,
      "mae_dtheta": 0.008156130090355873,
      "mae_dx": 0.00166953110601753,
      "mae_dy": 0.0018480761209502816,
      "pose_mae_dtheta": 0.054333582520484924,
      "pose_mae_dx": 0.015376863069832325,
      "pose_mae_dy": 0.02203386463224888,
      "pose_rmse_dtheta": 0.13071537017822266,
      "pose_rmse_dx": 0.03904282674193382,
      "pose_rmse_dy": 0.05006052181124687,
      "pose_rmse_mean": 0.07327291369438171,
      "rmse_dtheta": 0.017941048368811607,
      "rmse_dx": 0.0058415792882442474,
      "rmse_dy": 0.005114828702062368,
      "rmse_mean": 0.009632485918700695,
      "rotation_flip": 0.004642166197299957,
      "sparse_tokens": 32121.0,
      "step": 7297,
      "turn_loss": 0.06645517796278,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.3390633711206095,
      "grad_norm": 0.5285471081733704,
      "learning_rate": 3.393428712097526e-06,
      "loss": 0.1325,
      "mae_dtheta": 0.030244695022702217,
      "mae_dx": 0.010912159457802773,
      "mae_dy": 0.004539244808256626,
      "pose_mae_dtheta": 0.2132832556962967,
      "pose_mae_dx": 0.08361813426017761,
      "pose_mae_dy": 0.05758966878056526,
      "pose_rmse_dtheta": 0.3953166604042053,
      "pose_rmse_dx": 0.18420179188251495,
      "pose_rmse_dy": 0.14100998640060425,
      "pose_rmse_mean": 0.24017614126205444,
      "rmse_dtheta": 0.04873045161366463,
      "rmse_dx": 0.023109056055545807,
      "rmse_dy": 0.008933144621551037,
      "rmse_mean": 0.026924218982458115,
      "rotation_flip": 0.011523687280714512,
      "sparse_tokens": 12962.0,
      "step": 7298,
      "turn_loss": 0.26007410883903503,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.33910983088645236,
      "grad_norm": 0.4109099209308624,
      "learning_rate": 3.3921766629689012e-06,
      "loss": 0.1289,
      "mae_dtheta": 0.019516324624419212,
      "mae_dx": 0.00534026650711894,
      "mae_dy": 0.007205403409898281,
      "pose_mae_dtheta": 0.10694567114114761,
      "pose_mae_dx": 0.03413109853863716,
      "pose_mae_dy": 0.0850617066025734,
      "pose_rmse_dtheta": 0.155832901597023,
      "pose_rmse_dx": 0.07113619148731232,
      "pose_rmse_dy": 0.14617088437080383,
      "pose_rmse_mean": 0.12437999248504639,
      "rmse_dtheta": 0.03136449307203293,
      "rmse_dx": 0.01593148522078991,
      "rmse_dy": 0.01124558225274086,
      "rmse_mean": 0.019513854756951332,
      "rotation_flip": 0.029629629105329514,
      "sparse_tokens": 3233.0,
      "step": 7299,
      "turn_loss": 0.25049009919166565,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.33915629065229513,
      "grad_norm": 0.6517684459686279,
      "learning_rate": 3.3909247262762222e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.02245335280895233,
      "mae_dx": 0.009228686802089214,
      "mae_dy": 0.004745245445519686,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6517685651779175,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 146.4914093017578,
      "model/head/act_norm_mean": 103.59783440667229,
      "model/head/act_norm_min": 64.68396759033203,
      "model/head/act_over_embed": 71.1934017024719,
      "model/head/grad_frac": 0.10001049935817719,
      "model/head/grad_norm": 0.06518369913101196,
      "model/head/grad_zero_frac": 0.00017449946608394384,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6878431165540541,
      "model/head/update_ratio": 0.001111371093429625,
      "model/head/weight_delta": 9.489657402038574,
      "model/head/weight_delta_rel": 0.16647669672966003,
      "model/head/weight_norm": 58.65160369873047,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4218651056289673,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.421801767851177,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42176103591918945,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2898661238376965,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09636549651622772,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06280799955129623,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5350020559210527,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0020286564249545336,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0461196899414062,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09952622652053833,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96039390563965,
      "model/modality_embedder/grad_frac": 0.09636549651622772,
      "model/modality_embedder/grad_norm": 0.06280799955129623,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5350020559210527,
      "model/modality_embedder/update_ratio": 0.0020286564249545336,
      "model/modality_embedder/weight_delta": 3.0461196899414062,
      "model/modality_embedder/weight_delta_rel": 0.09952622652053833,
      "model/modality_embedder/weight_norm": 30.96039390563965,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.26371765136719,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.037855936293436,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.125362396240234,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.831830283226278,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10033048689365387,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06539225578308105,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002343087922781706,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5039126873016357,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09124408662319183,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.908578872680664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.6339340209961,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.92938585907336,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.659185409545898,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.444497992795284,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08502151817083359,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0554143525660038,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018667372642084956,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.176711082458496,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11004375666379929,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.685136795043945,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.12843322753906,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.63110822876448,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.597895622253418,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.613937537022853,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07761545479297638,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05058731138706207,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016504045343026519,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.431300640106201,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11521665006875992,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.65146255493164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.6565933227539,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.45166204150579,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.165606498718262,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.865039161432016,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08134542405605316,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.053018391132354736,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017740657785907388,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.936026096343994,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10033944249153137,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.88524627685547,
      "model/normalizer/grad_frac": 0.333804726600647,
      "model/normalizer/grad_norm": 0.2175634354352951,
      "model/normalizer/grad_zero_frac": 0.0001784424966899678,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002769309328868985,
      "model/normalizer/weight_delta": 6.203749179840088,
      "model/normalizer/weight_delta_rel": 0.07990069687366486,
      "model/normalizer/weight_norm": 78.56234741210938,
      "pose_mae_dtheta": 0.17083249986171722,
      "pose_mae_dx": 0.06519313901662827,
      "pose_mae_dy": 0.047531355172395706,
      "pose_rmse_dtheta": 0.3430708944797516,
      "pose_rmse_dx": 0.1430271714925766,
      "pose_rmse_dy": 0.10516750067472458,
      "pose_rmse_mean": 0.19708852469921112,
      "rmse_dtheta": 0.039101492613554,
      "rmse_dx": 0.02012431062757969,
      "rmse_dy": 0.010647675953805447,
      "rmse_mean": 0.02329116128385067,
      "rotation_flip": 0.011214952915906906,
      "sparse_tokens": 9671.0,
      "step": 7300,
      "turn_loss": 0.25927984714508057,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.3392027504181379,
      "grad_norm": 0.5825756788253784,
      "learning_rate": 3.389672902107044e-06,
      "loss": 0.1015,
      "mae_dtheta": 0.03197605162858963,
      "mae_dx": 0.010947606526315212,
      "mae_dy": 0.0053160726092755795,
      "pose_mae_dtheta": 0.24464362859725952,
      "pose_mae_dx": 0.08553781360387802,
      "pose_mae_dy": 0.05867035314440727,
      "pose_rmse_dtheta": 0.4494049847126007,
      "pose_rmse_dx": 0.20540201663970947,
      "pose_rmse_dy": 0.13598279654979706,
      "pose_rmse_mean": 0.2635965943336487,
      "rmse_dtheta": 0.050452083349227905,
      "rmse_dx": 0.022989748045802116,
      "rmse_dy": 0.011530899442732334,
      "rmse_mean": 0.028324244543910027,
      "rotation_flip": 0.018485914915800095,
      "sparse_tokens": 19985.0,
      "step": 7301,
      "turn_loss": 0.2604098916053772,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3392492101839807,
      "grad_norm": 0.42671263217926025,
      "learning_rate": 3.388421190548901e-06,
      "loss": 0.1045,
      "mae_dtheta": 0.009348521940410137,
      "mae_dx": 0.0019100077915936708,
      "mae_dy": 0.0019856207072734833,
      "pose_mae_dtheta": 0.06360957026481628,
      "pose_mae_dx": 0.024481941014528275,
      "pose_mae_dy": 0.024547982960939407,
      "pose_rmse_dtheta": 0.16740258038043976,
      "pose_rmse_dx": 0.06376919150352478,
      "pose_rmse_dy": 0.054988306015729904,
      "pose_rmse_mean": 0.09538669884204865,
      "rmse_dtheta": 0.021047323942184448,
      "rmse_dx": 0.006011659279465675,
      "rmse_dy": 0.004958746489137411,
      "rmse_mean": 0.01067257672548294,
      "rotation_flip": 0.003367003286257386,
      "sparse_tokens": 32073.0,
      "step": 7302,
      "turn_loss": 0.09280422329902649,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.33929566994982346,
      "grad_norm": 0.45226460695266724,
      "learning_rate": 3.3871695916893314e-06,
      "loss": 0.1336,
      "mae_dtheta": 0.012163667939603329,
      "mae_dx": 0.002145232865586877,
      "mae_dy": 0.003370236372575164,
      "pose_mae_dtheta": 0.08120778948068619,
      "pose_mae_dx": 0.02606729418039322,
      "pose_mae_dy": 0.03315310925245285,
      "pose_rmse_dtheta": 0.1855076253414154,
      "pose_rmse_dx": 0.07087395340204239,
      "pose_rmse_dy": 0.08087877184152603,
      "pose_rmse_mean": 0.11242011189460754,
      "rmse_dtheta": 0.025621308013796806,
      "rmse_dx": 0.0065911393612623215,
      "rmse_dy": 0.007848093286156654,
      "rmse_mean": 0.013353514485061169,
      "rotation_flip": 0.006000705994665623,
      "sparse_tokens": 32105.0,
      "step": 7303,
      "turn_loss": 0.09709431231021881,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.33934212971566624,
      "grad_norm": 0.5499831438064575,
      "learning_rate": 3.3859181056158565e-06,
      "loss": 0.1253,
      "mae_dtheta": 0.012914086692035198,
      "mae_dx": 0.0016927493270486593,
      "mae_dy": 0.0026018128264695406,
      "pose_mae_dtheta": 0.08247370272874832,
      "pose_mae_dx": 0.01891976036131382,
      "pose_mae_dy": 0.025012414902448654,
      "pose_rmse_dtheta": 0.250095009803772,
      "pose_rmse_dx": 0.06624570488929749,
      "pose_rmse_dy": 0.06057585030794144,
      "pose_rmse_mean": 0.12563885748386383,
      "rmse_dtheta": 0.030510716140270233,
      "rmse_dx": 0.005700094625353813,
      "rmse_dy": 0.006840858608484268,
      "rmse_mean": 0.014350557699799538,
      "rotation_flip": 0.00426521897315979,
      "sparse_tokens": 32121.0,
      "step": 7304,
      "turn_loss": 0.10248509794473648,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.339388589481509,
      "grad_norm": 0.49119454622268677,
      "learning_rate": 3.3846667324159952e-06,
      "loss": 0.1206,
      "mae_dtheta": 0.03135407716035843,
      "mae_dx": 0.013444339856505394,
      "mae_dy": 0.004419084172695875,
      "pose_mae_dtheta": 0.24122555553913116,
      "pose_mae_dx": 0.10654973983764648,
      "pose_mae_dy": 0.042083125561475754,
      "pose_rmse_dtheta": 0.37794020771980286,
      "pose_rmse_dx": 0.22182312607765198,
      "pose_rmse_dy": 0.09743116796016693,
      "pose_rmse_mean": 0.23239818215370178,
      "rmse_dtheta": 0.04550699517130852,
      "rmse_dx": 0.024760015308856964,
      "rmse_dy": 0.00909290462732315,
      "rmse_mean": 0.026453305035829544,
      "rotation_flip": 0.004587155766785145,
      "sparse_tokens": 7700.0,
      "step": 7305,
      "turn_loss": 0.2522366940975189,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.3394350492473518,
      "grad_norm": 1.5393517017364502,
      "learning_rate": 3.383415472177256e-06,
      "loss": 0.2438,
      "mae_dtheta": 0.035585127770900726,
      "mae_dx": 0.012973932549357414,
      "mae_dy": 0.00433743093162775,
      "pose_mae_dtheta": 0.29469034075737,
      "pose_mae_dx": 0.10409744083881378,
      "pose_mae_dy": 0.07400625944137573,
      "pose_rmse_dtheta": 0.5216917395591736,
      "pose_rmse_dx": 0.20420995354652405,
      "pose_rmse_dy": 0.2260967344045639,
      "pose_rmse_mean": 0.31733283400535583,
      "rmse_dtheta": 0.055584292858839035,
      "rmse_dx": 0.0238303542137146,
      "rmse_dy": 0.011204916052520275,
      "rmse_mean": 0.030206521973013878,
      "rotation_flip": 0.008474576286971569,
      "sparse_tokens": 9116.0,
      "step": 7306,
      "turn_loss": 0.2131040394306183,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 10377.0,
      "epoch": 0.33948150901319457,
      "grad_norm": 1.1749342679977417,
      "learning_rate": 3.3821643249871413e-06,
      "loss": 0.2728,
      "mae_dtheta": 0.04244304448366165,
      "mae_dx": 0.014116314239799976,
      "mae_dy": 0.005142151843756437,
      "pose_mae_dtheta": 0.34352681040763855,
      "pose_mae_dx": 0.1215963289141655,
      "pose_mae_dy": 0.05524696782231331,
      "pose_rmse_dtheta": 0.5567821860313416,
      "pose_rmse_dx": 0.25893905758857727,
      "pose_rmse_dy": 0.1607779860496521,
      "pose_rmse_mean": 0.3254997730255127,
      "rmse_dtheta": 0.059894051402807236,
      "rmse_dx": 0.026214463636279106,
      "rmse_dy": 0.011908148415386677,
      "rmse_mean": 0.0326722227036953,
      "rotation_flip": 0.026639344170689583,
      "sparse_tokens": 7896.0,
      "step": 7307,
      "turn_loss": 0.3668358325958252,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.33952796877903735,
      "grad_norm": 0.5286782383918762,
      "learning_rate": 3.3809132909331434e-06,
      "loss": 0.1829,
      "mae_dtheta": 0.035060785710811615,
      "mae_dx": 0.008909940719604492,
      "mae_dy": 0.007821527309715748,
      "pose_mae_dtheta": 0.26235225796699524,
      "pose_mae_dx": 0.07158245146274567,
      "pose_mae_dy": 0.07735384255647659,
      "pose_rmse_dtheta": 0.4759417772293091,
      "pose_rmse_dx": 0.15969803929328918,
      "pose_rmse_dy": 0.17747730016708374,
      "pose_rmse_mean": 0.27103903889656067,
      "rmse_dtheta": 0.05405702069401741,
      "rmse_dx": 0.018778808414936066,
      "rmse_dy": 0.017330976203083992,
      "rmse_mean": 0.03005560301244259,
      "rotation_flip": 0.014468085020780563,
      "sparse_tokens": 19658.0,
      "step": 7308,
      "turn_loss": 0.32352545857429504,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3395744285448801,
      "grad_norm": 0.4474852979183197,
      "learning_rate": 3.3796623701027477e-06,
      "loss": 0.0722,
      "mae_dtheta": 0.011798600666224957,
      "mae_dx": 0.0018906942568719387,
      "mae_dy": 0.001840880373492837,
      "pose_mae_dtheta": 0.07271359115839005,
      "pose_mae_dx": 0.020922580733895302,
      "pose_mae_dy": 0.026935596019029617,
      "pose_rmse_dtheta": 0.18898381292819977,
      "pose_rmse_dx": 0.05764652043581009,
      "pose_rmse_dy": 0.06464902311563492,
      "pose_rmse_mean": 0.10375978797674179,
      "rmse_dtheta": 0.026615751907229424,
      "rmse_dx": 0.006385501008480787,
      "rmse_dy": 0.00391734205186367,
      "rmse_mean": 0.012306198477745056,
      "rotation_flip": 0.004108463414013386,
      "sparse_tokens": 32153.0,
      "step": 7309,
      "turn_loss": 0.09381836652755737,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.3396208883107229,
      "grad_norm": 0.5174023509025574,
      "learning_rate": 3.3784115625834324e-06,
      "loss": 0.1143,
      "mae_dtheta": 0.03982021287083626,
      "mae_dx": 0.013203732669353485,
      "mae_dy": 0.0035833201836794615,
      "pose_mae_dtheta": 0.3174017667770386,
      "pose_mae_dx": 0.10699624568223953,
      "pose_mae_dy": 0.03828604146838188,
      "pose_rmse_dtheta": 0.5555713176727295,
      "pose_rmse_dx": 0.24825187027454376,
      "pose_rmse_dy": 0.09538575261831284,
      "pose_rmse_mean": 0.2997363209724426,
      "rmse_dtheta": 0.05836878716945648,
      "rmse_dx": 0.02633269876241684,
      "rmse_dy": 0.007438420318067074,
      "rmse_mean": 0.03071330301463604,
      "rotation_flip": 0.020710058510303497,
      "sparse_tokens": 11830.0,
      "step": 7310,
      "turn_loss": 0.22955375909805298,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3396673480765657,
      "grad_norm": 0.46001753211021423,
      "learning_rate": 3.3771608684626667e-06,
      "loss": 0.1406,
      "mae_dtheta": 0.01088010799139738,
      "mae_dx": 0.0018699883949011564,
      "mae_dy": 0.003128243377432227,
      "pose_mae_dtheta": 0.06991533190011978,
      "pose_mae_dx": 0.027215123176574707,
      "pose_mae_dy": 0.03338606283068657,
      "pose_rmse_dtheta": 0.14692531526088715,
      "pose_rmse_dx": 0.0675244927406311,
      "pose_rmse_dy": 0.07352793216705322,
      "pose_rmse_mean": 0.09599258750677109,
      "rmse_dtheta": 0.022457759827375412,
      "rmse_dx": 0.004748478997498751,
      "rmse_dy": 0.006387523375451565,
      "rmse_mean": 0.011197920888662338,
      "rotation_flip": 0.0070646414533257484,
      "sparse_tokens": 32105.0,
      "step": 7311,
      "turn_loss": 0.09669326990842819,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.33971380784240846,
      "grad_norm": 0.7145819067955017,
      "learning_rate": 3.375910287827912e-06,
      "loss": 0.1752,
      "mae_dtheta": 0.04144355654716492,
      "mae_dx": 0.005362442694604397,
      "mae_dy": 0.003940858878195286,
      "pose_mae_dtheta": 0.31453749537467957,
      "pose_mae_dx": 0.049931079149246216,
      "pose_mae_dy": 0.04678471013903618,
      "pose_rmse_dtheta": 0.5487711429595947,
      "pose_rmse_dx": 0.11859240382909775,
      "pose_rmse_dy": 0.1172112375497818,
      "pose_rmse_mean": 0.26152491569519043,
      "rmse_dtheta": 0.061375223100185394,
      "rmse_dx": 0.013850073330104351,
      "rmse_dy": 0.008744940161705017,
      "rmse_mean": 0.027990078553557396,
      "rotation_flip": 0.012944984249770641,
      "sparse_tokens": 18064.0,
      "step": 7312,
      "turn_loss": 0.28702765703201294,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.33976026760825123,
      "grad_norm": 0.37776023149490356,
      "learning_rate": 3.374659820766625e-06,
      "loss": 0.094,
      "mae_dtheta": 0.009445191361010075,
      "mae_dx": 0.001937404042109847,
      "mae_dy": 0.002946490654721856,
      "pose_mae_dtheta": 0.06408464163541794,
      "pose_mae_dx": 0.023934120312333107,
      "pose_mae_dy": 0.025566844269633293,
      "pose_rmse_dtheta": 0.15102702379226685,
      "pose_rmse_dx": 0.059637099504470825,
      "pose_rmse_dy": 0.052551109343767166,
      "pose_rmse_mean": 0.08773841708898544,
      "rmse_dtheta": 0.020769035443663597,
      "rmse_dx": 0.0047811828553676605,
      "rmse_dy": 0.006505565717816353,
      "rmse_mean": 0.010685261338949203,
      "rotation_flip": 0.006690279580652714,
      "sparse_tokens": 32105.0,
      "step": 7313,
      "turn_loss": 0.08842984586954117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.339806727374094,
      "grad_norm": 0.7367563247680664,
      "learning_rate": 3.3734094673662455e-06,
      "loss": 0.1255,
      "mae_dtheta": 0.03877983242273331,
      "mae_dx": 0.012021428905427456,
      "mae_dy": 0.007210419978946447,
      "pose_mae_dtheta": 0.34365200996398926,
      "pose_mae_dx": 0.10175507515668869,
      "pose_mae_dy": 0.050789911299943924,
      "pose_rmse_dtheta": 0.5526884198188782,
      "pose_rmse_dx": 0.25364524126052856,
      "pose_rmse_dy": 0.1618071347475052,
      "pose_rmse_mean": 0.32271361351013184,
      "rmse_dtheta": 0.05769289284944534,
      "rmse_dx": 0.023186322301626205,
      "rmse_dy": 0.0198382381349802,
      "rmse_mean": 0.0335724838078022,
      "rotation_flip": 0.014379085041582584,
      "sparse_tokens": 12946.0,
      "step": 7314,
      "turn_loss": 0.29758480191230774,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.33985318713993684,
      "grad_norm": 0.46157121658325195,
      "learning_rate": 3.372159227714218e-06,
      "loss": 0.097,
      "mae_dtheta": 0.009409545920789242,
      "mae_dx": 0.0024760363157838583,
      "mae_dy": 0.002301580272614956,
      "pose_mae_dtheta": 0.06407076120376587,
      "pose_mae_dx": 0.026730963960289955,
      "pose_mae_dy": 0.021397003903985023,
      "pose_rmse_dtheta": 0.16389143466949463,
      "pose_rmse_dx": 0.06339184939861298,
      "pose_rmse_dy": 0.04679466784000397,
      "pose_rmse_mean": 0.09135931730270386,
      "rmse_dtheta": 0.021201493218541145,
      "rmse_dx": 0.006587494630366564,
      "rmse_dy": 0.004977877717465162,
      "rmse_mean": 0.01092228852212429,
      "rotation_flip": 0.0046311612240970135,
      "sparse_tokens": 32217.0,
      "step": 7315,
      "turn_loss": 0.08196817338466644,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27905.0,
      "epoch": 0.3398996469057796,
      "grad_norm": 0.5658801794052124,
      "learning_rate": 3.3709091018979677e-06,
      "loss": 0.1511,
      "mae_dtheta": 0.0418204627931118,
      "mae_dx": 0.008379252627491951,
      "mae_dy": 0.0026674799155443907,
      "pose_mae_dtheta": 0.3349297344684601,
      "pose_mae_dx": 0.06899618357419968,
      "pose_mae_dy": 0.031239336356520653,
      "pose_rmse_dtheta": 0.5798124670982361,
      "pose_rmse_dx": 0.16506563127040863,
      "pose_rmse_dy": 0.07945652306079865,
      "pose_rmse_mean": 0.27477821707725525,
      "rmse_dtheta": 0.06244567781686783,
      "rmse_dx": 0.0186515711247921,
      "rmse_dy": 0.006165831349790096,
      "rmse_mean": 0.029087692499160767,
      "rotation_flip": 0.013550135307013988,
      "sparse_tokens": 21501.0,
      "step": 7316,
      "turn_loss": 0.2875487506389618,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 1658.0,
      "epoch": 0.3399461066716224,
      "grad_norm": 1.8940608501434326,
      "learning_rate": 3.3696590900049176e-06,
      "loss": 0.3491,
      "mae_dtheta": 0.04544101282954216,
      "mae_dx": 0.02978237345814705,
      "mae_dy": 0.0277510117739439,
      "pose_mae_dtheta": 0.49276235699653625,
      "pose_mae_dx": 0.1611393690109253,
      "pose_mae_dy": 0.40128329396247864,
      "pose_rmse_dtheta": 0.6087042689323425,
      "pose_rmse_dx": 0.22281035780906677,
      "pose_rmse_dy": 0.5025572180747986,
      "pose_rmse_mean": 0.44469064474105835,
      "rmse_dtheta": 0.05810900032520294,
      "rmse_dx": 0.03936642408370972,
      "rmse_dy": 0.030625592917203903,
      "rmse_mean": 0.04270034283399582,
      "rotation_flip": 0.056179776787757874,
      "sparse_tokens": 1508.0,
      "step": 7317,
      "turn_loss": 0.4545478820800781,
      "turns": 5.0,
      "turns_per_sample": 5.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.33999256643746517,
      "grad_norm": 0.7052285671234131,
      "learning_rate": 3.368409192122485e-06,
      "loss": 0.1224,
      "mae_dtheta": 0.006698898505419493,
      "mae_dx": 0.0015615691663697362,
      "mae_dy": 0.0012165437219664454,
      "pose_mae_dtheta": 0.03960232809185982,
      "pose_mae_dx": 0.015812315046787262,
      "pose_mae_dy": 0.016732176765799522,
      "pose_rmse_dtheta": 0.08955990523099899,
      "pose_rmse_dx": 0.05130747705698013,
      "pose_rmse_dy": 0.04380986839532852,
      "pose_rmse_mean": 0.061559081077575684,
      "rmse_dtheta": 0.016173554584383965,
      "rmse_dx": 0.005616475362330675,
      "rmse_dy": 0.002939918776974082,
      "rmse_mean": 0.008243316784501076,
      "rotation_flip": 0.0038910505827516317,
      "sparse_tokens": 32073.0,
      "step": 7318,
      "turn_loss": 0.05794379860162735,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.34003902620330795,
      "grad_norm": 0.7377856373786926,
      "learning_rate": 3.367159408338071e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.012058458290994167,
      "mae_dx": 0.0030512898229062557,
      "mae_dy": 0.004096250049769878,
      "pose_mae_dtheta": 0.08446712791919708,
      "pose_mae_dx": 0.04186927527189255,
      "pose_mae_dy": 0.034998372197151184,
      "pose_rmse_dtheta": 0.17485053837299347,
      "pose_rmse_dx": 0.11423411220312119,
      "pose_rmse_dy": 0.08197576552629471,
      "pose_rmse_mean": 0.12368680536746979,
      "rmse_dtheta": 0.0236415546387434,
      "rmse_dx": 0.00798451341688633,
      "rmse_dy": 0.009403439238667488,
      "rmse_mean": 0.01367650181055069,
      "rotation_flip": 0.006666666828095913,
      "sparse_tokens": 32169.0,
      "step": 7319,
      "turn_loss": 0.1212155818939209,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3400854859691507,
      "grad_norm": 0.4187506139278412,
      "learning_rate": 3.3659097387390784e-06,
      "loss": 0.1177,
      "mae_dtheta": 0.01103177573531866,
      "mae_dx": 0.001727186725474894,
      "mae_dy": 0.002754070097580552,
      "pose_mae_dtheta": 0.07142998278141022,
      "pose_mae_dx": 0.02329852804541588,
      "pose_mae_dy": 0.030480947345495224,
      "pose_rmse_dtheta": 0.15492510795593262,
      "pose_rmse_dx": 0.06554359197616577,
      "pose_rmse_dy": 0.07065911591053009,
      "pose_rmse_mean": 0.09704260528087616,
      "rmse_dtheta": 0.02230793796479702,
      "rmse_dx": 0.004789856728166342,
      "rmse_dy": 0.00582963228225708,
      "rmse_mean": 0.010975809767842293,
      "rotation_flip": 0.006983240135014057,
      "sparse_tokens": 32121.0,
      "step": 7320,
      "turn_loss": 0.10113967210054398,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3401319457349935,
      "grad_norm": 0.3988546133041382,
      "learning_rate": 3.3646601834128924e-06,
      "loss": 0.0649,
      "mae_dtheta": 0.008524834178388119,
      "mae_dx": 0.0012160779442638159,
      "mae_dy": 0.0014892923645675182,
      "pose_mae_dtheta": 0.06352045387029648,
      "pose_mae_dx": 0.0138003621250391,
      "pose_mae_dy": 0.021209871396422386,
      "pose_rmse_dtheta": 0.17258423566818237,
      "pose_rmse_dx": 0.037355415523052216,
      "pose_rmse_dy": 0.050685394555330276,
      "pose_rmse_mean": 0.08687502145767212,
      "rmse_dtheta": 0.02037406899034977,
      "rmse_dx": 0.0033141584135591984,
      "rmse_dy": 0.003519566496834159,
      "rmse_mean": 0.009069264866411686,
      "rotation_flip": 0.004299226216971874,
      "sparse_tokens": 32137.0,
      "step": 7321,
      "turn_loss": 0.05990217253565788,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3401784055008363,
      "grad_norm": 0.44260290265083313,
      "learning_rate": 3.3634107424468993e-06,
      "loss": 0.096,
      "mae_dtheta": 0.013445149175822735,
      "mae_dx": 0.0034828358329832554,
      "mae_dy": 0.004452116321772337,
      "pose_mae_dtheta": 0.09550590813159943,
      "pose_mae_dx": 0.04541749507188797,
      "pose_mae_dy": 0.038779404014348984,
      "pose_rmse_dtheta": 0.2161448895931244,
      "pose_rmse_dx": 0.11982084065675735,
      "pose_rmse_dy": 0.08526024222373962,
      "pose_rmse_mean": 0.14040866494178772,
      "rmse_dtheta": 0.027207178995013237,
      "rmse_dx": 0.008573494851589203,
      "rmse_dy": 0.009088038466870785,
      "rmse_mean": 0.014956238679587841,
      "rotation_flip": 0.009000321850180626,
      "sparse_tokens": 32185.0,
      "step": 7322,
      "turn_loss": 0.14421036839485168,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.34022486526667906,
      "grad_norm": 0.5120753645896912,
      "learning_rate": 3.3621614159284697e-06,
      "loss": 0.1823,
      "mae_dtheta": 0.04142303764820099,
      "mae_dx": 0.019297167658805847,
      "mae_dy": 0.009388498961925507,
      "pose_mae_dtheta": 0.30769726634025574,
      "pose_mae_dx": 0.14213132858276367,
      "pose_mae_dy": 0.10729959607124329,
      "pose_rmse_dtheta": 0.5039857625961304,
      "pose_rmse_dx": 0.29101836681365967,
      "pose_rmse_dy": 0.23335523903369904,
      "pose_rmse_mean": 0.3427864909172058,
      "rmse_dtheta": 0.05875791236758232,
      "rmse_dx": 0.03335081413388252,
      "rmse_dy": 0.01946791261434555,
      "rmse_mean": 0.0371922142803669,
      "rotation_flip": 0.01587301678955555,
      "sparse_tokens": 11917.0,
      "step": 7323,
      "turn_loss": 0.47162750363349915,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.34027132503252183,
      "grad_norm": 0.5367293357849121,
      "learning_rate": 3.360912203944972e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.011502659879624844,
      "mae_dx": 0.0024017859250307083,
      "mae_dy": 0.0029725527856498957,
      "pose_mae_dtheta": 0.07982836663722992,
      "pose_mae_dx": 0.02837623842060566,
      "pose_mae_dy": 0.032402556389570236,
      "pose_rmse_dtheta": 0.2185499668121338,
      "pose_rmse_dx": 0.0851975679397583,
      "pose_rmse_dy": 0.08702500909566879,
      "pose_rmse_mean": 0.1302575170993805,
      "rmse_dtheta": 0.026471847668290138,
      "rmse_dx": 0.0069823614321649075,
      "rmse_dy": 0.007780157029628754,
      "rmse_mean": 0.01374478917568922,
      "rotation_flip": 0.0046968404203653336,
      "sparse_tokens": 32089.0,
      "step": 7324,
      "turn_loss": 0.11196356266736984,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3403177847983646,
      "grad_norm": 0.457785040140152,
      "learning_rate": 3.3596631065837637e-06,
      "loss": 0.1139,
      "mae_dtheta": 0.008392870426177979,
      "mae_dx": 0.002148135332390666,
      "mae_dy": 0.0022800068836659193,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.45778515934944153,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 164.0960693359375,
      "model/head/act_norm_mean": 105.26366201073232,
      "model/head/act_norm_min": 58.98104476928711,
      "model/head/act_over_embed": 72.3381740277057,
      "model/head/grad_frac": 0.09432554990053177,
      "model/head/grad_norm": 0.043180838227272034,
      "model/head/grad_zero_frac": 0.00020908209262415767,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7075885811237373,
      "model/head/update_ratio": 0.000736202928237617,
      "model/head/weight_delta": 9.496832847595215,
      "model/head/weight_delta_rel": 0.16660258173942566,
      "model/head/weight_norm": 58.653446197509766,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42186617851257324,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4217918361473946,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42170700430870056,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2898592986778752,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10003471374511719,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04579440876841545,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5523190045248869,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014791222056373954,
      "model/modality_embedder.encoders.pose/weight_delta": 3.051349401473999,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09969709813594818,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96053123474121,
      "model/modality_embedder/grad_frac": 0.10003471374511719,
      "model/modality_embedder/grad_norm": 0.04579440876841545,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5523190045248869,
      "model/modality_embedder/update_ratio": 0.0014791222056373954,
      "model/modality_embedder/weight_delta": 3.051349401473999,
      "model/modality_embedder/weight_delta_rel": 0.09969709813594818,
      "model/modality_embedder/weight_norm": 30.96053123474121,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.67513275146484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.156896344396344,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.112740516662598,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.913635966148457,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06199906766414642,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.028382252901792526,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010169489542022347,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.507126569747925,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09136120229959488,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.90921974182129,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.6877212524414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.14448051948052,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.447420120239258,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.592313057175023,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06388009339570999,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.029243359342217445,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009850821224972606,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1809585094451904,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11019089072942734,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.686214447021484,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.56290435791016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.012232944524612,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.675880432128906,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.875850009839024,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07223048061132431,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0330660417675972,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010787477949634194,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.43587327003479,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11537019163370132,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.652246475219727,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.35179901123047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.793628246753247,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.322949409484863,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.10004153921612,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09247523546218872,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04233378916978836,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014164976309984922,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.9401185512542725,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10047929733991623,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.886241912841797,
      "model/normalizer/grad_frac": 0.31458544731140137,
      "model/normalizer/grad_norm": 0.14401255548000336,
      "model/normalizer/grad_zero_frac": 0.00023043899273034185,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001833072048611939,
      "model/normalizer/weight_delta": 6.212088584899902,
      "model/normalizer/weight_delta_rel": 0.08000810444355011,
      "model/normalizer/weight_norm": 78.5634994506836,
      "pose_mae_dtheta": 0.052061598747968674,
      "pose_mae_dx": 0.020401176065206528,
      "pose_mae_dy": 0.028325123712420464,
      "pose_rmse_dtheta": 0.09785304963588715,
      "pose_rmse_dx": 0.04716721922159195,
      "pose_rmse_dy": 0.06295463442802429,
      "pose_rmse_mean": 0.06932497024536133,
      "rmse_dtheta": 0.017647502943873405,
      "rmse_dx": 0.006755343172699213,
      "rmse_dy": 0.005118960980325937,
      "rmse_mean": 0.009840602055191994,
      "rotation_flip": 0.0036764706019312143,
      "sparse_tokens": 32089.0,
      "step": 7325,
      "turn_loss": 0.11040293425321579,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.3403642445642074,
      "grad_norm": 0.6958862543106079,
      "learning_rate": 3.3584141239321953e-06,
      "loss": 0.1607,
      "mae_dtheta": 0.02325114980340004,
      "mae_dx": 0.010927172377705574,
      "mae_dy": 0.005766564514487982,
      "pose_mae_dtheta": 0.17638476192951202,
      "pose_mae_dx": 0.07961515337228775,
      "pose_mae_dy": 0.07829328626394272,
      "pose_rmse_dtheta": 0.27954715490341187,
      "pose_rmse_dx": 0.17499826848506927,
      "pose_rmse_dy": 0.13622841238975525,
      "pose_rmse_mean": 0.1969246119260788,
      "rmse_dtheta": 0.035644128918647766,
      "rmse_dx": 0.022735610604286194,
      "rmse_dy": 0.010863419622182846,
      "rmse_mean": 0.023081054911017418,
      "rotation_flip": 0.028169013559818268,
      "sparse_tokens": 5154.0,
      "step": 7326,
      "turn_loss": 0.181823268532753,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.34041070433005016,
      "grad_norm": 0.3480813503265381,
      "learning_rate": 3.357165256077608e-06,
      "loss": 0.0823,
      "mae_dtheta": 0.012335581704974174,
      "mae_dx": 0.0027309958823025227,
      "mae_dy": 0.0038728739600628614,
      "pose_mae_dtheta": 0.09782526642084122,
      "pose_mae_dx": 0.036659639328718185,
      "pose_mae_dy": 0.0365731418132782,
      "pose_rmse_dtheta": 0.24067021906375885,
      "pose_rmse_dx": 0.10069513320922852,
      "pose_rmse_dy": 0.08746473491191864,
      "pose_rmse_mean": 0.1429433673620224,
      "rmse_dtheta": 0.02690022997558117,
      "rmse_dx": 0.007115725893527269,
      "rmse_dy": 0.008281255140900612,
      "rmse_mean": 0.014099071733653545,
      "rotation_flip": 0.0033978933934122324,
      "sparse_tokens": 32137.0,
      "step": 7327,
      "turn_loss": 0.12046071887016296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.34045716409589294,
      "grad_norm": 0.4762626886367798,
      "learning_rate": 3.3559165031073358e-06,
      "loss": 0.1416,
      "mae_dtheta": 0.008283489383757114,
      "mae_dx": 0.0014375618193298578,
      "mae_dy": 0.0018455219687893987,
      "pose_mae_dtheta": 0.05835985392332077,
      "pose_mae_dx": 0.018917202949523926,
      "pose_mae_dy": 0.024623338133096695,
      "pose_rmse_dtheta": 0.16301216185092926,
      "pose_rmse_dx": 0.06074065715074539,
      "pose_rmse_dy": 0.058069802820682526,
      "pose_rmse_mean": 0.09394087642431259,
      "rmse_dtheta": 0.01847260631620884,
      "rmse_dx": 0.005690361373126507,
      "rmse_dy": 0.0038493999745696783,
      "rmse_mean": 0.009337455965578556,
      "rotation_flip": 0.003822630038484931,
      "sparse_tokens": 32089.0,
      "step": 7328,
      "turn_loss": 0.07712050527334213,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3405036238617357,
      "grad_norm": 0.5122913718223572,
      "learning_rate": 3.354667865108706e-06,
      "loss": 0.1421,
      "mae_dtheta": 0.015434722416102886,
      "mae_dx": 0.002505282871425152,
      "mae_dy": 0.0032526629511266947,
      "pose_mae_dtheta": 0.10588109493255615,
      "pose_mae_dx": 0.03180356323719025,
      "pose_mae_dy": 0.04022044688463211,
      "pose_rmse_dtheta": 0.26285824179649353,
      "pose_rmse_dx": 0.07850342988967896,
      "pose_rmse_dy": 0.10375762730836868,
      "pose_rmse_mean": 0.1483730971813202,
      "rmse_dtheta": 0.03202440217137337,
      "rmse_dx": 0.00700009660795331,
      "rmse_dy": 0.006909037008881569,
      "rmse_mean": 0.015311179682612419,
      "rotation_flip": 0.003687315620481968,
      "sparse_tokens": 32121.0,
      "step": 7329,
      "turn_loss": 0.14873068034648895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.3405500836275785,
      "grad_norm": 0.5374142527580261,
      "learning_rate": 3.3534193421690348e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.03300681710243225,
      "mae_dx": 0.01331361010670662,
      "mae_dy": 0.011048964224755764,
      "pose_mae_dtheta": 0.2200150191783905,
      "pose_mae_dx": 0.13554014265537262,
      "pose_mae_dy": 0.12451224029064178,
      "pose_rmse_dtheta": 0.3745118975639343,
      "pose_rmse_dx": 0.27053162455558777,
      "pose_rmse_dy": 0.23941895365715027,
      "pose_rmse_mean": 0.2948208451271057,
      "rmse_dtheta": 0.04928557947278023,
      "rmse_dx": 0.02607334591448307,
      "rmse_dy": 0.0192785132676363,
      "rmse_mean": 0.031545814126729965,
      "rotation_flip": 0.020270269364118576,
      "sparse_tokens": 4842.0,
      "step": 7330,
      "turn_loss": 0.4136069715023041,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.3405965433934213,
      "grad_norm": 0.5154598951339722,
      "learning_rate": 3.3521709343756317e-06,
      "loss": 0.145,
      "mae_dtheta": 0.03538093715906143,
      "mae_dx": 0.009439521469175816,
      "mae_dy": 0.004864084534347057,
      "pose_mae_dtheta": 0.25684040784835815,
      "pose_mae_dx": 0.06595892459154129,
      "pose_mae_dy": 0.062286972999572754,
      "pose_rmse_dtheta": 0.5029153823852539,
      "pose_rmse_dx": 0.16615383327007294,
      "pose_rmse_dy": 0.14626377820968628,
      "pose_rmse_mean": 0.2717776894569397,
      "rmse_dtheta": 0.05367026850581169,
      "rmse_dx": 0.02113918587565422,
      "rmse_dy": 0.009716504253447056,
      "rmse_mean": 0.028175320476293564,
      "rotation_flip": 0.015299026854336262,
      "sparse_tokens": 12516.0,
      "step": 7331,
      "turn_loss": 0.23422257602214813,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.3406430031592641,
      "grad_norm": 0.861951470375061,
      "learning_rate": 3.3509226418158014e-06,
      "loss": 0.2323,
      "mae_dtheta": 0.03942445293068886,
      "mae_dx": 0.01586233824491501,
      "mae_dy": 0.00788508728146553,
      "pose_mae_dtheta": 0.32008546590805054,
      "pose_mae_dx": 0.12880757451057434,
      "pose_mae_dy": 0.09376084059476852,
      "pose_rmse_dtheta": 0.5236178040504456,
      "pose_rmse_dx": 0.26296672224998474,
      "pose_rmse_dy": 0.184387668967247,
      "pose_rmse_mean": 0.32365739345550537,
      "rmse_dtheta": 0.05647479370236397,
      "rmse_dx": 0.02945663221180439,
      "rmse_dy": 0.013702182099223137,
      "rmse_mean": 0.033211205154657364,
      "rotation_flip": 0.017582418397068977,
      "sparse_tokens": 22195.0,
      "step": 7332,
      "turn_loss": 0.3439598083496094,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3406894629251069,
      "grad_norm": 0.4748973250389099,
      "learning_rate": 3.349674464576834e-06,
      "loss": 0.0832,
      "mae_dtheta": 0.009398247115314007,
      "mae_dx": 0.0019831168465316296,
      "mae_dy": 0.003019846510142088,
      "pose_mae_dtheta": 0.06124500557780266,
      "pose_mae_dx": 0.020628711208701134,
      "pose_mae_dy": 0.027095913887023926,
      "pose_rmse_dtheta": 0.14272937178611755,
      "pose_rmse_dx": 0.051845651119947433,
      "pose_rmse_dy": 0.059594668447971344,
      "pose_rmse_mean": 0.08472323417663574,
      "rmse_dtheta": 0.020404929295182228,
      "rmse_dx": 0.006430330686271191,
      "rmse_dy": 0.006953944452106953,
      "rmse_mean": 0.011263067834079266,
      "rotation_flip": 0.004660194274038076,
      "sparse_tokens": 32089.0,
      "step": 7333,
      "turn_loss": 0.08526141196489334,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.34073592269094966,
      "grad_norm": 0.49476292729377747,
      "learning_rate": 3.34842640274602e-06,
      "loss": 0.0836,
      "mae_dtheta": 0.007619802840054035,
      "mae_dx": 0.001488871406763792,
      "mae_dy": 0.001299630617722869,
      "pose_mae_dtheta": 0.05130399018526077,
      "pose_mae_dx": 0.013897825963795185,
      "pose_mae_dy": 0.01547224447131157,
      "pose_rmse_dtheta": 0.15882991254329681,
      "pose_rmse_dx": 0.04960743710398674,
      "pose_rmse_dy": 0.03773299232125282,
      "pose_rmse_mean": 0.08205678313970566,
      "rmse_dtheta": 0.020526396110653877,
      "rmse_dx": 0.0060704899951815605,
      "rmse_dy": 0.0034180290531367064,
      "rmse_mean": 0.01000497117638588,
      "rotation_flip": 0.002076843287795782,
      "sparse_tokens": 32073.0,
      "step": 7334,
      "turn_loss": 0.05069280415773392,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.34078238245679243,
      "grad_norm": 0.39721640944480896,
      "learning_rate": 3.3471784564106315e-06,
      "loss": 0.0761,
      "mae_dtheta": 0.00934568326920271,
      "mae_dx": 0.002642350969836116,
      "mae_dy": 0.002934499876573682,
      "pose_mae_dtheta": 0.06900767982006073,
      "pose_mae_dx": 0.026359129697084427,
      "pose_mae_dy": 0.025684582069516182,
      "pose_rmse_dtheta": 0.18377546966075897,
      "pose_rmse_dx": 0.09881992638111115,
      "pose_rmse_dy": 0.06533501297235489,
      "pose_rmse_mean": 0.11597680300474167,
      "rmse_dtheta": 0.02324986830353737,
      "rmse_dx": 0.008581021800637245,
      "rmse_dy": 0.007992280647158623,
      "rmse_mean": 0.013274392113089561,
      "rotation_flip": 0.015789473429322243,
      "sparse_tokens": 32073.0,
      "step": 7335,
      "turn_loss": 0.10679291188716888,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.3408288422226352,
      "grad_norm": 0.6579559445381165,
      "learning_rate": 3.3459306256579405e-06,
      "loss": 0.1524,
      "mae_dtheta": 0.026785433292388916,
      "mae_dx": 0.01083887554705143,
      "mae_dy": 0.0032598029356449842,
      "pose_mae_dtheta": 0.21024295687675476,
      "pose_mae_dx": 0.0876552015542984,
      "pose_mae_dy": 0.03925982862710953,
      "pose_rmse_dtheta": 0.3749350905418396,
      "pose_rmse_dx": 0.19948050379753113,
      "pose_rmse_dy": 0.09168390929698944,
      "pose_rmse_mean": 0.22203317284584045,
      "rmse_dtheta": 0.0417000986635685,
      "rmse_dx": 0.022953659296035767,
      "rmse_dy": 0.006363897118717432,
      "rmse_mean": 0.023672550916671753,
      "rotation_flip": 0.021052632480859756,
      "sparse_tokens": 12410.0,
      "step": 7336,
      "turn_loss": 0.21499088406562805,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 33634.0,
      "epoch": 0.340875301988478,
      "grad_norm": 0.5660468935966492,
      "learning_rate": 3.3446829105752103e-06,
      "loss": 0.1468,
      "mae_dtheta": 0.04024842754006386,
      "mae_dx": 0.010515728034079075,
      "mae_dy": 0.006143996026366949,
      "pose_mae_dtheta": 0.3000275790691376,
      "pose_mae_dx": 0.08418793231248856,
      "pose_mae_dy": 0.06520122289657593,
      "pose_rmse_dtheta": 0.5269472002983093,
      "pose_rmse_dx": 0.20672889053821564,
      "pose_rmse_dy": 0.15431511402130127,
      "pose_rmse_mean": 0.29599708318710327,
      "rmse_dtheta": 0.058806538581848145,
      "rmse_dx": 0.023137817159295082,
      "rmse_dy": 0.012294329702854156,
      "rmse_mean": 0.031412895768880844,
      "rotation_flip": 0.018929503858089447,
      "sparse_tokens": 26122.0,
      "step": 7337,
      "turn_loss": 0.3000964820384979,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.34092176175432076,
      "grad_norm": 0.6046302914619446,
      "learning_rate": 3.343435311249691e-06,
      "loss": 0.1576,
      "mae_dtheta": 0.0084763765335083,
      "mae_dx": 0.0014948189491406083,
      "mae_dy": 0.0020687782671302557,
      "pose_mae_dtheta": 0.05718125030398369,
      "pose_mae_dx": 0.018403498455882072,
      "pose_mae_dy": 0.02307690866291523,
      "pose_rmse_dtheta": 0.17550291121006012,
      "pose_rmse_dx": 0.04780316352844238,
      "pose_rmse_dy": 0.06163550913333893,
      "pose_rmse_mean": 0.09498053044080734,
      "rmse_dtheta": 0.020853770896792412,
      "rmse_dx": 0.004209143575280905,
      "rmse_dy": 0.004731804598122835,
      "rmse_mean": 0.009931573644280434,
      "rotation_flip": 0.0040716612711548805,
      "sparse_tokens": 32105.0,
      "step": 7338,
      "turn_loss": 0.06545934081077576,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13282.0,
      "epoch": 0.34096822152016354,
      "grad_norm": 0.5464452505111694,
      "learning_rate": 3.3421878277686315e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.029451213777065277,
      "mae_dx": 0.011614433489739895,
      "mae_dy": 0.005355938337743282,
      "pose_mae_dtheta": 0.22343182563781738,
      "pose_mae_dx": 0.09957174211740494,
      "pose_mae_dy": 0.06851647794246674,
      "pose_rmse_dtheta": 0.3922642767429352,
      "pose_rmse_dx": 0.22361117601394653,
      "pose_rmse_dy": 0.14001066982746124,
      "pose_rmse_mean": 0.2519620656967163,
      "rmse_dtheta": 0.04578482732176781,
      "rmse_dx": 0.02502358704805374,
      "rmse_dy": 0.011122704483568668,
      "rmse_mean": 0.02731037139892578,
      "rotation_flip": 0.010733452625572681,
      "sparse_tokens": 11201.0,
      "step": 7339,
      "turn_loss": 0.19363519549369812,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3410146812860063,
      "grad_norm": 0.6822400689125061,
      "learning_rate": 3.3409404602192654e-06,
      "loss": 0.1551,
      "mae_dtheta": 0.012229306623339653,
      "mae_dx": 0.0016171431634575129,
      "mae_dy": 0.002333682496100664,
      "pose_mae_dtheta": 0.08436717838048935,
      "pose_mae_dx": 0.024082453921437263,
      "pose_mae_dy": 0.028477206826210022,
      "pose_rmse_dtheta": 0.2389320284128189,
      "pose_rmse_dx": 0.07596607506275177,
      "pose_rmse_dy": 0.07568079978227615,
      "pose_rmse_mean": 0.13019296526908875,
      "rmse_dtheta": 0.028537170961499214,
      "rmse_dx": 0.0058092111721634865,
      "rmse_dy": 0.005580028984695673,
      "rmse_mean": 0.013308804482221603,
      "rotation_flip": 0.0052863433957099915,
      "sparse_tokens": 32041.0,
      "step": 7340,
      "turn_loss": 0.07858556509017944,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3410611410518491,
      "grad_norm": 0.7567607760429382,
      "learning_rate": 3.3396932086888245e-06,
      "loss": 0.1389,
      "mae_dtheta": 0.00923783890902996,
      "mae_dx": 0.0025549393612891436,
      "mae_dy": 0.0021527730859816074,
      "pose_mae_dtheta": 0.06528855115175247,
      "pose_mae_dx": 0.02451079711318016,
      "pose_mae_dy": 0.028589921072125435,
      "pose_rmse_dtheta": 0.20155702531337738,
      "pose_rmse_dx": 0.09179286658763885,
      "pose_rmse_dy": 0.09003555774688721,
      "pose_rmse_mean": 0.12779515981674194,
      "rmse_dtheta": 0.02358630858361721,
      "rmse_dx": 0.009780647233128548,
      "rmse_dy": 0.006012125872075558,
      "rmse_mean": 0.013126361183822155,
      "rotation_flip": 0.004464285913854837,
      "sparse_tokens": 32089.0,
      "step": 7341,
      "turn_loss": 0.1013428270816803,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.34110760081769187,
      "grad_norm": 0.5096560120582581,
      "learning_rate": 3.3384460732645274e-06,
      "loss": 0.1084,
      "mae_dtheta": 0.012377793900668621,
      "mae_dx": 0.00161558180116117,
      "mae_dy": 0.0029761388432234526,
      "pose_mae_dtheta": 0.07726114243268967,
      "pose_mae_dx": 0.026189660653471947,
      "pose_mae_dy": 0.03584792837500572,
      "pose_rmse_dtheta": 0.15975335240364075,
      "pose_rmse_dx": 0.06922254711389542,
      "pose_rmse_dy": 0.07644771039485931,
      "pose_rmse_mean": 0.10180787742137909,
      "rmse_dtheta": 0.02386704832315445,
      "rmse_dx": 0.005212345160543919,
      "rmse_dy": 0.007093051914125681,
      "rmse_mean": 0.01205748226493597,
      "rotation_flip": 0.0049982150085270405,
      "sparse_tokens": 32089.0,
      "step": 7342,
      "turn_loss": 0.101344995200634,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.34115406058353465,
      "grad_norm": 0.4389336407184601,
      "learning_rate": 3.3371990540335893e-06,
      "loss": 0.0943,
      "mae_dtheta": 0.04286982864141464,
      "mae_dx": 0.007850990630686283,
      "mae_dy": 0.003312700428068638,
      "pose_mae_dtheta": 0.45777496695518494,
      "pose_mae_dx": 0.057183463126420975,
      "pose_mae_dy": 0.0636681467294693,
      "pose_rmse_dtheta": 0.7712414860725403,
      "pose_rmse_dx": 0.13488465547561646,
      "pose_rmse_dy": 0.15818101167678833,
      "pose_rmse_mean": 0.3547690808773041,
      "rmse_dtheta": 0.0663953572511673,
      "rmse_dx": 0.017567748203873634,
      "rmse_dy": 0.007011974696069956,
      "rmse_mean": 0.0303250253200531,
      "rotation_flip": 0.01953125,
      "sparse_tokens": 3764.0,
      "step": 7343,
      "turn_loss": 0.20142929255962372,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3412005203493774,
      "grad_norm": 0.5401812195777893,
      "learning_rate": 3.3359521510832134e-06,
      "loss": 0.1264,
      "mae_dtheta": 0.008735152892768383,
      "mae_dx": 0.001627618446946144,
      "mae_dy": 0.0028395953122526407,
      "pose_mae_dtheta": 0.0632958635687828,
      "pose_mae_dx": 0.025781508535146713,
      "pose_mae_dy": 0.026637889444828033,
      "pose_rmse_dtheta": 0.1523132175207138,
      "pose_rmse_dx": 0.08147519081830978,
      "pose_rmse_dy": 0.06336145848035812,
      "pose_rmse_mean": 0.09904995560646057,
      "rmse_dtheta": 0.01940242573618889,
      "rmse_dx": 0.0043554529547691345,
      "rmse_dy": 0.006575076375156641,
      "rmse_mean": 0.010110985487699509,
      "rotation_flip": 0.003544702660292387,
      "sparse_tokens": 32073.0,
      "step": 7344,
      "turn_loss": 0.07046783715486526,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.3412469801152202,
      "grad_norm": 0.6651277542114258,
      "learning_rate": 3.3347053645005965e-06,
      "loss": 0.1698,
      "mae_dtheta": 0.046844810247421265,
      "mae_dx": 0.009043663740158081,
      "mae_dy": 0.009721428155899048,
      "pose_mae_dtheta": 0.3981111943721771,
      "pose_mae_dx": 0.05217601731419563,
      "pose_mae_dy": 0.09898451715707779,
      "pose_rmse_dtheta": 0.6286565661430359,
      "pose_rmse_dx": 0.10542203485965729,
      "pose_rmse_dy": 0.2485021948814392,
      "pose_rmse_mean": 0.32752692699432373,
      "rmse_dtheta": 0.06642406433820724,
      "rmse_dx": 0.019205942749977112,
      "rmse_dy": 0.02207648567855358,
      "rmse_mean": 0.03590216487646103,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 4785.0,
      "step": 7345,
      "turn_loss": 0.31836584210395813,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.341293439881063,
      "grad_norm": 0.4198566973209381,
      "learning_rate": 3.333458694372928e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.03013005293905735,
      "mae_dx": 0.012977667152881622,
      "mae_dy": 0.0066705550998449326,
      "pose_mae_dtheta": 0.24215570092201233,
      "pose_mae_dx": 0.12029984593391418,
      "pose_mae_dy": 0.06754758954048157,
      "pose_rmse_dtheta": 0.39708244800567627,
      "pose_rmse_dx": 0.2557125687599182,
      "pose_rmse_dy": 0.1584288477897644,
      "pose_rmse_mean": 0.2704079747200012,
      "rmse_dtheta": 0.04633580893278122,
      "rmse_dx": 0.02507677674293518,
      "rmse_dy": 0.014079051092267036,
      "rmse_mean": 0.028497211635112762,
      "rotation_flip": 0.017467249184846878,
      "sparse_tokens": 19674.0,
      "step": 7346,
      "turn_loss": 0.2905395030975342,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.34133989964690575,
      "grad_norm": 0.3554595112800598,
      "learning_rate": 3.332212140787387e-06,
      "loss": 0.0804,
      "mae_dtheta": 0.008705333806574345,
      "mae_dx": 0.0016917139291763306,
      "mae_dy": 0.001862762845121324,
      "pose_mae_dtheta": 0.05809665843844414,
      "pose_mae_dx": 0.018229756504297256,
      "pose_mae_dy": 0.022238101810216904,
      "pose_rmse_dtheta": 0.1379353106021881,
      "pose_rmse_dx": 0.04256453365087509,
      "pose_rmse_dy": 0.04747399315237999,
      "pose_rmse_mean": 0.07599128782749176,
      "rmse_dtheta": 0.018620779737830162,
      "rmse_dx": 0.004935520235449076,
      "rmse_dy": 0.0037424839101731777,
      "rmse_mean": 0.009099595248699188,
      "rotation_flip": 0.0028849621303379536,
      "sparse_tokens": 32153.0,
      "step": 7347,
      "turn_loss": 0.07795444130897522,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3413863594127486,
      "grad_norm": 0.5019818544387817,
      "learning_rate": 3.330965703831146e-06,
      "loss": 0.1214,
      "mae_dtheta": 0.010139704681932926,
      "mae_dx": 0.0019616575445979834,
      "mae_dy": 0.001634949934668839,
      "pose_mae_dtheta": 0.06749959290027618,
      "pose_mae_dx": 0.023187777027487755,
      "pose_mae_dy": 0.02262241765856743,
      "pose_rmse_dtheta": 0.19021478295326233,
      "pose_rmse_dx": 0.05944313481450081,
      "pose_rmse_dy": 0.05480647459626198,
      "pose_rmse_mean": 0.1014881357550621,
      "rmse_dtheta": 0.024721791967749596,
      "rmse_dx": 0.005902735982090235,
      "rmse_dy": 0.003929667174816132,
      "rmse_mean": 0.011518064886331558,
      "rotation_flip": 0.0005316321039572358,
      "sparse_tokens": 32089.0,
      "step": 7348,
      "turn_loss": 0.08376085013151169,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.34143281917859136,
      "grad_norm": 0.6265546679496765,
      "learning_rate": 3.32971938359137e-06,
      "loss": 0.119,
      "mae_dtheta": 0.024846618995070457,
      "mae_dx": 0.010435114614665508,
      "mae_dy": 0.005465796682983637,
      "pose_mae_dtheta": 0.1694088876247406,
      "pose_mae_dx": 0.06786838918924332,
      "pose_mae_dy": 0.0674235075712204,
      "pose_rmse_dtheta": 0.28378644585609436,
      "pose_rmse_dx": 0.16552293300628662,
      "pose_rmse_dy": 0.14429938793182373,
      "pose_rmse_mean": 0.19786958396434784,
      "rmse_dtheta": 0.03842027485370636,
      "rmse_dx": 0.022621696814894676,
      "rmse_dy": 0.009687201119959354,
      "rmse_mean": 0.023576391860842705,
      "rotation_flip": 0.004813477862626314,
      "sparse_tokens": 14783.0,
      "step": 7349,
      "turn_loss": 0.2353864312171936,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.34147927894443414,
      "grad_norm": 0.6280381083488464,
      "learning_rate": 3.328473180155212e-06,
      "loss": 0.1178,
      "mae_dtheta": 0.011451833881437778,
      "mae_dx": 0.0017870627343654633,
      "mae_dy": 0.0026134366635233164,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6280378699302673,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 164.12486267089844,
      "model/head/act_norm_mean": 109.01113675820707,
      "model/head/act_norm_min": 66.35687255859375,
      "model/head/act_over_embed": 74.9134737585817,
      "model/head/grad_frac": 0.08005080372095108,
      "model/head/grad_norm": 0.050274934619665146,
      "model/head/grad_zero_frac": 0.0001250050845555961,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7033124210858586,
      "model/head/update_ratio": 0.0008571339421905577,
      "model/head/weight_delta": 9.505377769470215,
      "model/head/weight_delta_rel": 0.16675248742103577,
      "model/head/weight_norm": 58.654701232910156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4219147264957428,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4218529520580947,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4217763841152191,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.28990129810388443,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09435302764177322,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05925727263092995,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5390883122246696,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019139491487294436,
      "model/modality_embedder.encoders.pose/weight_delta": 3.051361083984375,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09969747811555862,
      "model/modality_embedder.encoders.pose/weight_norm": 30.960735321044922,
      "model/modality_embedder/grad_frac": 0.09435302764177322,
      "model/modality_embedder/grad_norm": 0.05925727263092995,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5390883122246696,
      "model/modality_embedder/update_ratio": 0.0019139491487294436,
      "model/modality_embedder/weight_delta": 3.051361083984375,
      "model/modality_embedder/weight_delta_rel": 0.09969747811555862,
      "model/modality_embedder/weight_norm": 30.960735321044922,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.52357482910156,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.529626623376622,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.901914596557617,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.169779703419554,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05136878788471222,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03226154297590256,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011559230042621493,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5105433464050293,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09148571640253067,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.90976905822754,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.7500228881836,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.526798240339907,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.215810775756836,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.85504537426449,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0530511699616909,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03331814333796501,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011222853790968657,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.185713768005371,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11035561561584473,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.68776512145996,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.8034896850586,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.389465087381755,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.650556564331055,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.135087470113415,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05703217163681984,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03581836447119713,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011095868103438988,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011684895725920796,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.4408814907073975,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11553835868835449,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.6535587310791,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.73468017578125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.153331429373097,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.404199600219727,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.347232933906735,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06918805837631226,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04345272108912468,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014538808027282357,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.9445836544036865,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10063189268112183,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.887401580810547,
      "model/normalizer/grad_frac": 0.2338455468416214,
      "model/normalizer/grad_norm": 0.14686386287212372,
      "model/normalizer/grad_zero_frac": 0.00014062687114346772,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018693351885303855,
      "model/normalizer/weight_delta": 6.2211480140686035,
      "model/normalizer/weight_delta_rel": 0.08012478798627853,
      "model/normalizer/weight_norm": 78.56475830078125,
      "pose_mae_dtheta": 0.07968363910913467,
      "pose_mae_dx": 0.02625611238181591,
      "pose_mae_dy": 0.03258417174220085,
      "pose_rmse_dtheta": 0.1647000014781952,
      "pose_rmse_dx": 0.06145526468753815,
      "pose_rmse_dy": 0.06962850689888,
      "pose_rmse_mean": 0.09859459102153778,
      "rmse_dtheta": 0.0219607912003994,
      "rmse_dx": 0.005130390636622906,
      "rmse_dy": 0.004980121739208698,
      "rmse_mean": 0.010690434835851192,
      "rotation_flip": 0.0017064845887944102,
      "sparse_tokens": 32137.0,
      "step": 7350,
      "turn_loss": 0.08817996084690094,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.3415257387102769,
      "grad_norm": 0.552858293056488,
      "learning_rate": 3.3272270936098243e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.03180008754134178,
      "mae_dx": 0.013041110709309578,
      "mae_dy": 0.016395850107073784,
      "pose_mae_dtheta": 0.18889863789081573,
      "pose_mae_dx": 0.06180271878838539,
      "pose_mae_dy": 0.1263614147901535,
      "pose_rmse_dtheta": 0.30840590596199036,
      "pose_rmse_dx": 0.12093738466501236,
      "pose_rmse_dy": 0.2685180604457855,
      "pose_rmse_mean": 0.2326204478740692,
      "rmse_dtheta": 0.05291373282670975,
      "rmse_dx": 0.021848082542419434,
      "rmse_dy": 0.031122568994760513,
      "rmse_mean": 0.0352947972714901,
      "rotation_flip": 0.02380952425301075,
      "sparse_tokens": 2547.0,
      "step": 7351,
      "turn_loss": 0.4516248106956482,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3415721984761197,
      "grad_norm": 0.408666729927063,
      "learning_rate": 3.325981124042341e-06,
      "loss": 0.0963,
      "mae_dtheta": 0.011615416966378689,
      "mae_dx": 0.001886808779090643,
      "mae_dy": 0.0025190110318362713,
      "pose_mae_dtheta": 0.06827852129936218,
      "pose_mae_dx": 0.02148309536278248,
      "pose_mae_dy": 0.031423088163137436,
      "pose_rmse_dtheta": 0.14004935324192047,
      "pose_rmse_dx": 0.0507141537964344,
      "pose_rmse_dy": 0.0650346651673317,
      "pose_rmse_mean": 0.08526605367660522,
      "rmse_dtheta": 0.02274073287844658,
      "rmse_dx": 0.0058973864652216434,
      "rmse_dy": 0.005355313420295715,
      "rmse_mean": 0.011331143788993359,
      "rotation_flip": 0.005361930467188358,
      "sparse_tokens": 32105.0,
      "step": 7352,
      "turn_loss": 0.10034558176994324,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.34161865824196247,
      "grad_norm": 0.5706980228424072,
      "learning_rate": 3.3247352715398995e-06,
      "loss": 0.0898,
      "mae_dtheta": 0.03388092666864395,
      "mae_dx": 0.012127157300710678,
      "mae_dy": 0.0031830722000449896,
      "pose_mae_dtheta": 0.28437918424606323,
      "pose_mae_dx": 0.09416010230779648,
      "pose_mae_dy": 0.032407477498054504,
      "pose_rmse_dtheta": 0.5000972151756287,
      "pose_rmse_dx": 0.25975942611694336,
      "pose_rmse_dy": 0.08167776465415955,
      "pose_rmse_mean": 0.2805114686489105,
      "rmse_dtheta": 0.05343914404511452,
      "rmse_dx": 0.026789529249072075,
      "rmse_dy": 0.005786315072327852,
      "rmse_mean": 0.028671663254499435,
      "rotation_flip": 0.01312335953116417,
      "sparse_tokens": 6634.0,
      "step": 7353,
      "turn_loss": 0.21371574699878693,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.34166511800780525,
      "grad_norm": 0.6568129062652588,
      "learning_rate": 3.323489536189617e-06,
      "loss": 0.1506,
      "mae_dtheta": 0.03519834578037262,
      "mae_dx": 0.009864285588264465,
      "mae_dy": 0.004763011820614338,
      "pose_mae_dtheta": 0.2762576937675476,
      "pose_mae_dx": 0.08529090136289597,
      "pose_mae_dy": 0.07274144142866135,
      "pose_rmse_dtheta": 0.4585288166999817,
      "pose_rmse_dx": 0.20089608430862427,
      "pose_rmse_dy": 0.16884973645210266,
      "pose_rmse_mean": 0.2760915458202362,
      "rmse_dtheta": 0.05255415290594101,
      "rmse_dx": 0.02153651975095272,
      "rmse_dy": 0.009193390607833862,
      "rmse_mean": 0.02776135504245758,
      "rotation_flip": 0.009101251140236855,
      "sparse_tokens": 16195.0,
      "step": 7354,
      "turn_loss": 0.22296367585659027,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.341711577773648,
      "grad_norm": 0.4675796926021576,
      "learning_rate": 3.32224391807861e-06,
      "loss": 0.1029,
      "mae_dtheta": 0.027185700833797455,
      "mae_dx": 0.00779860420152545,
      "mae_dy": 0.0035473941825330257,
      "pose_mae_dtheta": 0.18598781526088715,
      "pose_mae_dx": 0.04995621368288994,
      "pose_mae_dy": 0.0390811488032341,
      "pose_rmse_dtheta": 0.3260456621646881,
      "pose_rmse_dx": 0.13648782670497894,
      "pose_rmse_dy": 0.10455393046140671,
      "pose_rmse_mean": 0.18902914226055145,
      "rmse_dtheta": 0.043152641505002975,
      "rmse_dx": 0.01929752342402935,
      "rmse_dy": 0.006673101335763931,
      "rmse_mean": 0.02304108999669552,
      "rotation_flip": 0.0077720205299556255,
      "sparse_tokens": 6494.0,
      "step": 7355,
      "turn_loss": 0.17947633564472198,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.3417580375394908,
      "grad_norm": 0.714294970035553,
      "learning_rate": 3.32099841729399e-06,
      "loss": 0.2055,
      "mae_dtheta": 0.030756806954741478,
      "mae_dx": 0.007057518698275089,
      "mae_dy": 0.0075819967314600945,
      "pose_mae_dtheta": 0.19225800037384033,
      "pose_mae_dx": 0.059796907007694244,
      "pose_mae_dy": 0.088716059923172,
      "pose_rmse_dtheta": 0.3235837519168854,
      "pose_rmse_dx": 0.1293073296546936,
      "pose_rmse_dy": 0.16821222007274628,
      "pose_rmse_mean": 0.20703443884849548,
      "rmse_dtheta": 0.04450559988617897,
      "rmse_dx": 0.01680409349501133,
      "rmse_dy": 0.012110444717109203,
      "rmse_mean": 0.02447338029742241,
      "rotation_flip": 0.003496503457427025,
      "sparse_tokens": 4963.0,
      "step": 7356,
      "turn_loss": 0.2584023177623749,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.3418044973053336,
      "grad_norm": 0.525742769241333,
      "learning_rate": 3.319753033922849e-06,
      "loss": 0.0772,
      "mae_dtheta": 0.04184481129050255,
      "mae_dx": 0.027515271678566933,
      "mae_dy": 0.01397666335105896,
      "pose_mae_dtheta": 0.3444066643714905,
      "pose_mae_dx": 0.2275475114583969,
      "pose_mae_dy": 0.1498248130083084,
      "pose_rmse_dtheta": 0.4952085316181183,
      "pose_rmse_dx": 0.4132820665836334,
      "pose_rmse_dy": 0.28557199239730835,
      "pose_rmse_mean": 0.39802086353302,
      "rmse_dtheta": 0.057342417538166046,
      "rmse_dx": 0.04167413339018822,
      "rmse_dy": 0.024528125301003456,
      "rmse_mean": 0.04118155688047409,
      "rotation_flip": 0.009756097570061684,
      "sparse_tokens": 4027.0,
      "step": 7357,
      "turn_loss": 0.5941168665885925,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.34185095707117635,
      "grad_norm": 0.33497288823127747,
      "learning_rate": 3.3185077680522826e-06,
      "loss": 0.091,
      "mae_dtheta": 0.00959369633346796,
      "mae_dx": 0.0021607084199786186,
      "mae_dy": 0.0030382771510630846,
      "pose_mae_dtheta": 0.06712997704744339,
      "pose_mae_dx": 0.02735362946987152,
      "pose_mae_dy": 0.026601692661643028,
      "pose_rmse_dtheta": 0.17775879800319672,
      "pose_rmse_dx": 0.07667620480060577,
      "pose_rmse_dy": 0.060932308435440063,
      "pose_rmse_mean": 0.10512243956327438,
      "rmse_dtheta": 0.020832601934671402,
      "rmse_dx": 0.00574631430208683,
      "rmse_dy": 0.006765057798475027,
      "rmse_mean": 0.011114658787846565,
      "rotation_flip": 0.004334121476858854,
      "sparse_tokens": 32121.0,
      "step": 7358,
      "turn_loss": 0.07752126455307007,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.34189741683701913,
      "grad_norm": 0.7636728286743164,
      "learning_rate": 3.317262619769368e-06,
      "loss": 0.221,
      "mae_dtheta": 0.02582237310707569,
      "mae_dx": 0.008698240853846073,
      "mae_dy": 0.0041000936180353165,
      "pose_mae_dtheta": 0.20262612402439117,
      "pose_mae_dx": 0.06387341767549515,
      "pose_mae_dy": 0.05557924136519432,
      "pose_rmse_dtheta": 0.35213637351989746,
      "pose_rmse_dx": 0.14664442837238312,
      "pose_rmse_dy": 0.11444298923015594,
      "pose_rmse_mean": 0.2044079303741455,
      "rmse_dtheta": 0.039589278399944305,
      "rmse_dx": 0.019448155537247658,
      "rmse_dy": 0.007179214619100094,
      "rmse_mean": 0.022072216495871544,
      "rotation_flip": 0.015455950982868671,
      "sparse_tokens": 11437.0,
      "step": 7359,
      "turn_loss": 0.17691542208194733,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3419438766028619,
      "grad_norm": 0.775367796421051,
      "learning_rate": 3.316017589161184e-06,
      "loss": 0.1927,
      "mae_dtheta": 0.010808124206960201,
      "mae_dx": 0.001815883326344192,
      "mae_dy": 0.0031409456860274076,
      "pose_mae_dtheta": 0.07583669573068619,
      "pose_mae_dx": 0.027433328330516815,
      "pose_mae_dy": 0.03214242681860924,
      "pose_rmse_dtheta": 0.15252991020679474,
      "pose_rmse_dx": 0.07254091650247574,
      "pose_rmse_dy": 0.06749916076660156,
      "pose_rmse_mean": 0.09752333164215088,
      "rmse_dtheta": 0.020327258855104446,
      "rmse_dx": 0.005300168879330158,
      "rmse_dy": 0.006509638857096434,
      "rmse_mean": 0.010712355375289917,
      "rotation_flip": 0.002456140238791704,
      "sparse_tokens": 32073.0,
      "step": 7360,
      "turn_loss": 0.10063092410564423,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3419903363687047,
      "grad_norm": 0.41055941581726074,
      "learning_rate": 3.3147726763147913e-06,
      "loss": 0.0868,
      "mae_dtheta": 0.006550442893058062,
      "mae_dx": 0.0014752893475815654,
      "mae_dy": 0.0015635215677320957,
      "pose_mae_dtheta": 0.04461473226547241,
      "pose_mae_dx": 0.020216407254338264,
      "pose_mae_dy": 0.0194260086864233,
      "pose_rmse_dtheta": 0.09016286581754684,
      "pose_rmse_dx": 0.05091173201799393,
      "pose_rmse_dy": 0.05197547748684883,
      "pose_rmse_mean": 0.06435002386569977,
      "rmse_dtheta": 0.014316652901470661,
      "rmse_dx": 0.0041399127803742886,
      "rmse_dy": 0.004416915588080883,
      "rmse_mean": 0.007624493446201086,
      "rotation_flip": 0.0019417476141825318,
      "sparse_tokens": 32169.0,
      "step": 7361,
      "turn_loss": 0.0500766858458519,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.34203679613454746,
      "grad_norm": 0.40236738324165344,
      "learning_rate": 3.3135278813172515e-06,
      "loss": 0.0897,
      "mae_dtheta": 0.024445589631795883,
      "mae_dx": 0.005224515218287706,
      "mae_dy": 0.0021554077975451946,
      "pose_mae_dtheta": 0.1870843470096588,
      "pose_mae_dx": 0.044222719967365265,
      "pose_mae_dy": 0.04586142674088478,
      "pose_rmse_dtheta": 0.2886393666267395,
      "pose_rmse_dx": 0.10309087485074997,
      "pose_rmse_dy": 0.1269538253545761,
      "pose_rmse_mean": 0.1728947013616562,
      "rmse_dtheta": 0.038764048367738724,
      "rmse_dx": 0.014608318917453289,
      "rmse_dy": 0.004391644150018692,
      "rmse_mean": 0.019254671409726143,
      "rotation_flip": 0.00374531839042902,
      "sparse_tokens": 5069.0,
      "step": 7362,
      "turn_loss": 0.1687335968017578,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.34208325590039024,
      "grad_norm": 0.6070127487182617,
      "learning_rate": 3.3122832042556118e-06,
      "loss": 0.1299,
      "mae_dtheta": 0.008784874342381954,
      "mae_dx": 0.0015316925710067153,
      "mae_dy": 0.0019813862163573503,
      "pose_mae_dtheta": 0.06390992552042007,
      "pose_mae_dx": 0.019487811252474785,
      "pose_mae_dy": 0.026859134435653687,
      "pose_rmse_dtheta": 0.17737863957881927,
      "pose_rmse_dx": 0.06238307058811188,
      "pose_rmse_dy": 0.0772867351770401,
      "pose_rmse_mean": 0.10568281263113022,
      "rmse_dtheta": 0.020891711115837097,
      "rmse_dx": 0.005113295279443264,
      "rmse_dy": 0.00593428174033761,
      "rmse_mean": 0.010646430775523186,
      "rotation_flip": 0.002610966097563505,
      "sparse_tokens": 32073.0,
      "step": 7363,
      "turn_loss": 0.0582287535071373,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17481.0,
      "epoch": 0.34212971566623307,
      "grad_norm": 0.5609501600265503,
      "learning_rate": 3.311038645216914e-06,
      "loss": 0.1161,
      "mae_dtheta": 0.034632664173841476,
      "mae_dx": 0.008586343377828598,
      "mae_dy": 0.00554428156465292,
      "pose_mae_dtheta": 0.2859150171279907,
      "pose_mae_dx": 0.07132735103368759,
      "pose_mae_dy": 0.07133878767490387,
      "pose_rmse_dtheta": 0.5523947477340698,
      "pose_rmse_dx": 0.15828964114189148,
      "pose_rmse_dy": 0.16931647062301636,
      "pose_rmse_mean": 0.29333364963531494,
      "rmse_dtheta": 0.055551379919052124,
      "rmse_dx": 0.018901139497756958,
      "rmse_dy": 0.01303327176719904,
      "rmse_mean": 0.029161930084228516,
      "rotation_flip": 0.011904762126505375,
      "sparse_tokens": 14241.0,
      "step": 7364,
      "turn_loss": 0.26239344477653503,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.34217617543207585,
      "grad_norm": 0.4627419114112854,
      "learning_rate": 3.309794204288189e-06,
      "loss": 0.0924,
      "mae_dtheta": 0.028701843693852425,
      "mae_dx": 0.009101147763431072,
      "mae_dy": 0.0048812078312039375,
      "pose_mae_dtheta": 0.2349306046962738,
      "pose_mae_dx": 0.06766970455646515,
      "pose_mae_dy": 0.06935851275920868,
      "pose_rmse_dtheta": 0.39783886075019836,
      "pose_rmse_dx": 0.1638980209827423,
      "pose_rmse_dy": 0.15341977775096893,
      "pose_rmse_mean": 0.23838555812835693,
      "rmse_dtheta": 0.044506847858428955,
      "rmse_dx": 0.0200280100107193,
      "rmse_dy": 0.00875911395996809,
      "rmse_mean": 0.024431323632597923,
      "rotation_flip": 0.008143322542309761,
      "sparse_tokens": 10912.0,
      "step": 7365,
      "turn_loss": 0.24032680690288544,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.3422226351979186,
      "grad_norm": 0.3167467415332794,
      "learning_rate": 3.3085498815564644e-06,
      "loss": 0.0827,
      "mae_dtheta": 0.024526899680495262,
      "mae_dx": 0.008276380598545074,
      "mae_dy": 0.005347643978893757,
      "pose_mae_dtheta": 0.16134534776210785,
      "pose_mae_dx": 0.07322780787944794,
      "pose_mae_dy": 0.08659099787473679,
      "pose_rmse_dtheta": 0.3301410377025604,
      "pose_rmse_dx": 0.175899937748909,
      "pose_rmse_dy": 0.19805504381656647,
      "pose_rmse_mean": 0.23469868302345276,
      "rmse_dtheta": 0.041110340505838394,
      "rmse_dx": 0.02125326171517372,
      "rmse_dy": 0.009570403024554253,
      "rmse_mean": 0.02397800236940384,
      "rotation_flip": 0.009345794096589088,
      "sparse_tokens": 14086.0,
      "step": 7366,
      "turn_loss": 0.20038112998008728,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3422690949637614,
      "grad_norm": 0.384811669588089,
      "learning_rate": 3.307305677108753e-06,
      "loss": 0.0561,
      "mae_dtheta": 0.009356584399938583,
      "mae_dx": 0.0009954877896234393,
      "mae_dy": 0.0014696404105052352,
      "pose_mae_dtheta": 0.060118213295936584,
      "pose_mae_dx": 0.013157072477042675,
      "pose_mae_dy": 0.021584443747997284,
      "pose_rmse_dtheta": 0.17030072212219238,
      "pose_rmse_dx": 0.034276384860277176,
      "pose_rmse_dy": 0.05076652765274048,
      "pose_rmse_mean": 0.08511453866958618,
      "rmse_dtheta": 0.022236919030547142,
      "rmse_dx": 0.0033876735251396894,
      "rmse_dy": 0.0030123787000775337,
      "rmse_mean": 0.009545656852424145,
      "rotation_flip": 0.0041928719729185104,
      "sparse_tokens": 32073.0,
      "step": 7367,
      "turn_loss": 0.05585576966404915,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3423155547296042,
      "grad_norm": 0.3279092311859131,
      "learning_rate": 3.306061591032064e-06,
      "loss": 0.075,
      "mae_dtheta": 0.010478198528289795,
      "mae_dx": 0.001421597902663052,
      "mae_dy": 0.0023706587962806225,
      "pose_mae_dtheta": 0.06921101361513138,
      "pose_mae_dx": 0.021091986447572708,
      "pose_mae_dy": 0.031405165791511536,
      "pose_rmse_dtheta": 0.16780181229114532,
      "pose_rmse_dx": 0.04889492318034172,
      "pose_rmse_dy": 0.08351641148328781,
      "pose_rmse_mean": 0.10007105767726898,
      "rmse_dtheta": 0.02228698693215847,
      "rmse_dx": 0.003937531262636185,
      "rmse_dy": 0.005020493641495705,
      "rmse_mean": 0.010415004566311836,
      "rotation_flip": 0.0036791758611798286,
      "sparse_tokens": 32089.0,
      "step": 7368,
      "turn_loss": 0.08021264523267746,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35902.0,
      "epoch": 0.34236201449544695,
      "grad_norm": 0.8546319007873535,
      "learning_rate": 3.3048176234133967e-06,
      "loss": 0.2885,
      "mae_dtheta": 0.03590920567512512,
      "mae_dx": 0.01257731020450592,
      "mae_dy": 0.007178980391472578,
      "pose_mae_dtheta": 0.2915411591529846,
      "pose_mae_dx": 0.09753473103046417,
      "pose_mae_dy": 0.07042433321475983,
      "pose_rmse_dtheta": 0.4671176075935364,
      "pose_rmse_dx": 0.2111675888299942,
      "pose_rmse_dy": 0.17486052215099335,
      "pose_rmse_mean": 0.2843819260597229,
      "rmse_dtheta": 0.05220853537321091,
      "rmse_dx": 0.024653779342770576,
      "rmse_dy": 0.013534561730921268,
      "rmse_mean": 0.030132291838526726,
      "rotation_flip": 0.016533637419342995,
      "sparse_tokens": 28098.0,
      "step": 7369,
      "turn_loss": 0.319009393453598,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.34240847426128973,
      "grad_norm": 0.5768486857414246,
      "learning_rate": 3.303573774339745e-06,
      "loss": 0.1764,
      "mae_dtheta": 0.011798941530287266,
      "mae_dx": 0.0028569975402206182,
      "mae_dy": 0.002451327396556735,
      "pose_mae_dtheta": 0.08868640661239624,
      "pose_mae_dx": 0.022843213751912117,
      "pose_mae_dy": 0.0210114773362875,
      "pose_rmse_dtheta": 0.244155153632164,
      "pose_rmse_dx": 0.06273088604211807,
      "pose_rmse_dy": 0.05149495229125023,
      "pose_rmse_mean": 0.1194603368639946,
      "rmse_dtheta": 0.02858257107436657,
      "rmse_dx": 0.008649592287838459,
      "rmse_dy": 0.007610911503434181,
      "rmse_mean": 0.01494769286364317,
      "rotation_flip": 0.004841549322009087,
      "sparse_tokens": 32105.0,
      "step": 7370,
      "turn_loss": 0.12023063004016876,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3424549340271325,
      "grad_norm": 0.5490058660507202,
      "learning_rate": 3.302330043898088e-06,
      "loss": 0.1113,
      "mae_dtheta": 0.007950515486299992,
      "mae_dx": 0.0015966306673362851,
      "mae_dy": 0.0018453283701092005,
      "pose_mae_dtheta": 0.0557810515165329,
      "pose_mae_dx": 0.019001755863428116,
      "pose_mae_dy": 0.024331502616405487,
      "pose_rmse_dtheta": 0.11378203332424164,
      "pose_rmse_dx": 0.05148954316973686,
      "pose_rmse_dy": 0.06295168399810791,
      "pose_rmse_mean": 0.07607442140579224,
      "rmse_dtheta": 0.016090618446469307,
      "rmse_dx": 0.0051055834628641605,
      "rmse_dy": 0.004209497943520546,
      "rmse_mean": 0.008468566462397575,
      "rotation_flip": 0.002913025440648198,
      "sparse_tokens": 32105.0,
      "step": 7371,
      "turn_loss": 0.0687648132443428,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3425013937929753,
      "grad_norm": 0.6151048541069031,
      "learning_rate": 3.301086432175403e-06,
      "loss": 0.1621,
      "mae_dtheta": 0.00822377111762762,
      "mae_dx": 0.0015875413082540035,
      "mae_dy": 0.0022399830631911755,
      "pose_mae_dtheta": 0.052302729338407516,
      "pose_mae_dx": 0.021951207891106606,
      "pose_mae_dy": 0.023952895775437355,
      "pose_rmse_dtheta": 0.1147296279668808,
      "pose_rmse_dx": 0.058528270572423935,
      "pose_rmse_dy": 0.053993646055459976,
      "pose_rmse_mean": 0.07575051486492157,
      "rmse_dtheta": 0.01719311624765396,
      "rmse_dx": 0.004649210721254349,
      "rmse_dy": 0.005034837871789932,
      "rmse_mean": 0.008959054946899414,
      "rotation_flip": 0.00606848718598485,
      "sparse_tokens": 32089.0,
      "step": 7372,
      "turn_loss": 0.06905075162649155,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.34254785355881806,
      "grad_norm": 0.691197395324707,
      "learning_rate": 3.2998429392586552e-06,
      "loss": 0.1655,
      "mae_dtheta": 0.02981691062450409,
      "mae_dx": 0.009118981659412384,
      "mae_dy": 0.0027542682364583015,
      "pose_mae_dtheta": 0.2213781625032425,
      "pose_mae_dx": 0.06702817231416702,
      "pose_mae_dy": 0.03726055473089218,
      "pose_rmse_dtheta": 0.44224658608436584,
      "pose_rmse_dx": 0.14902916550636292,
      "pose_rmse_dy": 0.11807821691036224,
      "pose_rmse_mean": 0.23645132780075073,
      "rmse_dtheta": 0.049831416457891464,
      "rmse_dx": 0.02021317183971405,
      "rmse_dy": 0.0067183226346969604,
      "rmse_mean": 0.025587638840079308,
      "rotation_flip": 0.01411509234458208,
      "sparse_tokens": 14320.0,
      "step": 7373,
      "turn_loss": 0.2058870494365692,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.34259431332466084,
      "grad_norm": 0.477739542722702,
      "learning_rate": 3.298599565234802e-06,
      "loss": 0.1342,
      "mae_dtheta": 0.025472134351730347,
      "mae_dx": 0.005376019515097141,
      "mae_dy": 0.0018537178402766585,
      "pose_mae_dtheta": 0.18891364336013794,
      "pose_mae_dx": 0.04580454155802727,
      "pose_mae_dy": 0.026934754103422165,
      "pose_rmse_dtheta": 0.39042478799819946,
      "pose_rmse_dx": 0.11129194498062134,
      "pose_rmse_dy": 0.07041793316602707,
      "pose_rmse_mean": 0.19071155786514282,
      "rmse_dtheta": 0.046492449939250946,
      "rmse_dx": 0.013484927825629711,
      "rmse_dy": 0.0038668508641421795,
      "rmse_mean": 0.0212814100086689,
      "rotation_flip": 0.010856453329324722,
      "sparse_tokens": 15297.0,
      "step": 7374,
      "turn_loss": 0.17469185590744019,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.3426407730905036,
      "grad_norm": 0.5762851238250732,
      "learning_rate": 3.297356310190797e-06,
      "loss": 0.1915,
      "mae_dtheta": 0.03168734908103943,
      "mae_dx": 0.01175561361014843,
      "mae_dy": 0.007594375405460596,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.576285183429718,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 146.9231719970703,
      "model/head/act_norm_mean": 108.7469921875,
      "model/head/act_norm_min": 75.45721435546875,
      "model/head/act_over_embed": 74.73195113663137,
      "model/head/grad_frac": 0.1068359836935997,
      "model/head/grad_norm": 0.0615679956972599,
      "model/head/grad_zero_frac": 0.00020273665722925216,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7022265625,
      "model/head/update_ratio": 0.0010496387258172035,
      "model/head/weight_delta": 9.512290954589844,
      "model/head/weight_delta_rel": 0.1668737530708313,
      "model/head/weight_norm": 58.656368255615234,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4219973087310791,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4219973087310791,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4219973087310791,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29000050136104777,
      "model/modality_embedder.encoders.pose/grad_frac": 0.042124342173337936,
      "model/modality_embedder.encoders.pose/grad_norm": 0.024275634437799454,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 1.6851784039317863e-06,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0007840832113288343,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0545809268951416,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09980268031358719,
      "model/modality_embedder.encoders.pose/weight_norm": 30.960533142089844,
      "model/modality_embedder/grad_frac": 0.042124342173337936,
      "model/modality_embedder/grad_norm": 0.024275634437799454,
      "model/modality_embedder/grad_zero_frac": 1.6851784039317863e-06,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0007840832113288343,
      "model/modality_embedder/weight_delta": 3.0545809268951416,
      "model/modality_embedder/weight_delta_rel": 0.09980268031358719,
      "model/modality_embedder/weight_norm": 30.960533142089844,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.81005096435547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.49817791005291,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.138681411743164,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.148167853196007,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08597114682197571,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.049543898552656174,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017750679980963469,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.514634847640991,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09163480997085571,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.910985946655273,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 82.18366241455078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.289011243386245,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.606060028076172,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.69163592376099,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07767676562070847,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.044763967394828796,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015077597927302122,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1905269622802734,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11052234470844269,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.689058303833008,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.80925750732422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.875658068783068,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.90985107421875,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.7819944765953,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08696728944778442,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.050117962062358856,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016348896315321326,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.4456558227539062,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1156986728310585,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.655258178710938,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.27847290039062,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.76414021164021,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.624533653259277,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.07977708541511,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09162760525941849,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.052803631871938705,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017666664207354188,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.948981761932373,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10078220069408417,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.888853073120117,
      "model/normalizer/grad_frac": 0.3541340231895447,
      "model/normalizer/grad_norm": 0.204082190990448,
      "model/normalizer/grad_zero_frac": 0.00020207726629450917,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0025975708849728107,
      "model/normalizer/weight_delta": 6.2302961349487305,
      "model/normalizer/weight_delta_rel": 0.08024260401725769,
      "model/normalizer/weight_norm": 78.5665512084961,
      "pose_mae_dtheta": 0.2739904522895813,
      "pose_mae_dx": 0.09469173848628998,
      "pose_mae_dy": 0.10811414569616318,
      "pose_rmse_dtheta": 0.4523472487926483,
      "pose_rmse_dx": 0.20891357958316803,
      "pose_rmse_dy": 0.22079651057720184,
      "pose_rmse_mean": 0.2940191328525543,
      "rmse_dtheta": 0.04651765525341034,
      "rmse_dx": 0.024067312479019165,
      "rmse_dy": 0.01342929620295763,
      "rmse_mean": 0.028004756197333336,
      "rotation_flip": 0.021943572908639908,
      "sparse_tokens": 19250.0,
      "step": 7375,
      "turn_loss": 0.25297868251800537,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3426872328563464,
      "grad_norm": 0.523663341999054,
      "learning_rate": 3.2961131742135766e-06,
      "loss": 0.1782,
      "mae_dtheta": 0.007688682526350021,
      "mae_dx": 0.001142106018960476,
      "mae_dy": 0.0015270417788997293,
      "pose_mae_dtheta": 0.052461620420217514,
      "pose_mae_dx": 0.015744660049676895,
      "pose_mae_dy": 0.022015104070305824,
      "pose_rmse_dtheta": 0.13534234464168549,
      "pose_rmse_dx": 0.03913683071732521,
      "pose_rmse_dy": 0.05452069640159607,
      "pose_rmse_mean": 0.07633329182863235,
      "rmse_dtheta": 0.018076082691550255,
      "rmse_dx": 0.0036347745917737484,
      "rmse_dy": 0.0033434887882322073,
      "rmse_mean": 0.00835144892334938,
      "rotation_flip": 0.0011966493912041187,
      "sparse_tokens": 32089.0,
      "step": 7376,
      "turn_loss": 0.06153460592031479,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.34273369262218917,
      "grad_norm": 0.6563559174537659,
      "learning_rate": 3.2948701573900786e-06,
      "loss": 0.1338,
      "mae_dtheta": 0.023062074556946754,
      "mae_dx": 0.004330615047365427,
      "mae_dy": 0.0019924722146242857,
      "pose_mae_dtheta": 0.13632692396640778,
      "pose_mae_dx": 0.033052075654268265,
      "pose_mae_dy": 0.019321367144584656,
      "pose_rmse_dtheta": 0.28925803303718567,
      "pose_rmse_dx": 0.11195027828216553,
      "pose_rmse_dy": 0.04490493983030319,
      "pose_rmse_mean": 0.1487044245004654,
      "rmse_dtheta": 0.0426940955221653,
      "rmse_dx": 0.013003911823034286,
      "rmse_dy": 0.0035460852086544037,
      "rmse_mean": 0.019748032093048096,
      "rotation_flip": 0.006410256493836641,
      "sparse_tokens": 3355.0,
      "step": 7377,
      "turn_loss": 0.10814035683870316,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.34278015238803194,
      "grad_norm": 0.5314849019050598,
      "learning_rate": 3.2936272598072237e-06,
      "loss": 0.0799,
      "mae_dtheta": 0.00880524329841137,
      "mae_dx": 0.0018730618758127093,
      "mae_dy": 0.0009151729755103588,
      "pose_mae_dtheta": 0.06022808700799942,
      "pose_mae_dx": 0.01747589185833931,
      "pose_mae_dy": 0.011884286999702454,
      "pose_rmse_dtheta": 0.21370582282543182,
      "pose_rmse_dx": 0.04749681428074837,
      "pose_rmse_dy": 0.0336768813431263,
      "pose_rmse_mean": 0.09829317778348923,
      "rmse_dtheta": 0.026595614850521088,
      "rmse_dx": 0.006191832944750786,
      "rmse_dy": 0.002471179934218526,
      "rmse_mean": 0.011752876453101635,
      "rotation_flip": 0.002139037474989891,
      "sparse_tokens": 32153.0,
      "step": 7378,
      "turn_loss": 0.07281146198511124,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3428266121538747,
      "grad_norm": 0.5394047498703003,
      "learning_rate": 3.292384481551933e-06,
      "loss": 0.1206,
      "mae_dtheta": 0.01124279759824276,
      "mae_dx": 0.003263347316533327,
      "mae_dy": 0.003346460172906518,
      "pose_mae_dtheta": 0.07873126119375229,
      "pose_mae_dx": 0.03994617238640785,
      "pose_mae_dy": 0.039068806916475296,
      "pose_rmse_dtheta": 0.14972232282161713,
      "pose_rmse_dx": 0.11778002977371216,
      "pose_rmse_dy": 0.08958294987678528,
      "pose_rmse_mean": 0.11902844160795212,
      "rmse_dtheta": 0.021483059972524643,
      "rmse_dx": 0.010130285285413265,
      "rmse_dy": 0.007762443739920855,
      "rmse_mean": 0.013125263154506683,
      "rotation_flip": 0.0028860028833150864,
      "sparse_tokens": 32057.0,
      "step": 7379,
      "turn_loss": 0.13763707876205444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3428730719197175,
      "grad_norm": 0.4597001373767853,
      "learning_rate": 3.2911418227111096e-06,
      "loss": 0.0803,
      "mae_dtheta": 0.008726636879146099,
      "mae_dx": 0.0010546304984018207,
      "mae_dy": 0.0013751802034676075,
      "pose_mae_dtheta": 0.059795644134283066,
      "pose_mae_dx": 0.01260174810886383,
      "pose_mae_dy": 0.020791098475456238,
      "pose_rmse_dtheta": 0.1724015474319458,
      "pose_rmse_dx": 0.0327005609869957,
      "pose_rmse_dy": 0.045054201036691666,
      "pose_rmse_mean": 0.08338543772697449,
      "rmse_dtheta": 0.02142314799129963,
      "rmse_dx": 0.003641747171059251,
      "rmse_dy": 0.0029842990916222334,
      "rmse_mean": 0.009349731728434563,
      "rotation_flip": 0.0028248587623238564,
      "sparse_tokens": 32073.0,
      "step": 7380,
      "turn_loss": 0.059419333934783936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.34291953168556033,
      "grad_norm": 0.46197599172592163,
      "learning_rate": 3.289899283371657e-06,
      "loss": 0.0873,
      "mae_dtheta": 0.006986287888139486,
      "mae_dx": 0.0008986530592665076,
      "mae_dy": 0.0005125628667883575,
      "pose_mae_dtheta": 0.05230202153325081,
      "pose_mae_dx": 0.007732155732810497,
      "pose_mae_dy": 0.010130957700312138,
      "pose_rmse_dtheta": 0.22680319845676422,
      "pose_rmse_dx": 0.01756349764764309,
      "pose_rmse_dy": 0.030686477199196815,
      "pose_rmse_mean": 0.09168439358472824,
      "rmse_dtheta": 0.025721095502376556,
      "rmse_dx": 0.002765016397461295,
      "rmse_dy": 0.0011187271447852254,
      "rmse_mean": 0.009868280030786991,
      "rotation_flip": 0.0006468305364251137,
      "sparse_tokens": 32121.0,
      "step": 7381,
      "turn_loss": 0.0381176583468914,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3429659914514031,
      "grad_norm": 0.46530482172966003,
      "learning_rate": 3.288656863620465e-06,
      "loss": 0.112,
      "mae_dtheta": 0.009379306808114052,
      "mae_dx": 0.0014320035697892308,
      "mae_dy": 0.002535637002438307,
      "pose_mae_dtheta": 0.06199529394507408,
      "pose_mae_dx": 0.022805986925959587,
      "pose_mae_dy": 0.03144583851099014,
      "pose_rmse_dtheta": 0.1467377245426178,
      "pose_rmse_dx": 0.061936940997838974,
      "pose_rmse_dy": 0.0911862701177597,
      "pose_rmse_mean": 0.09995365142822266,
      "rmse_dtheta": 0.021089734509587288,
      "rmse_dx": 0.003787524765357375,
      "rmse_dy": 0.0055842348374426365,
      "rmse_mean": 0.010153831914067268,
      "rotation_flip": 0.00591016560792923,
      "sparse_tokens": 32073.0,
      "step": 7382,
      "turn_loss": 0.08831366896629333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3430124512172459,
      "grad_norm": 0.5218551754951477,
      "learning_rate": 3.287414563544417e-06,
      "loss": 0.1385,
      "mae_dtheta": 0.013675601221621037,
      "mae_dx": 0.0019808909855782986,
      "mae_dy": 0.0032902327366173267,
      "pose_mae_dtheta": 0.08861036598682404,
      "pose_mae_dx": 0.026914838701486588,
      "pose_mae_dy": 0.037053972482681274,
      "pose_rmse_dtheta": 0.21054743230342865,
      "pose_rmse_dx": 0.06807441264390945,
      "pose_rmse_dy": 0.09452587366104126,
      "pose_rmse_mean": 0.12438257783651352,
      "rmse_dtheta": 0.02779630571603775,
      "rmse_dx": 0.005495163146406412,
      "rmse_dy": 0.007690361700952053,
      "rmse_mean": 0.0136606115847826,
      "rotation_flip": 0.006686478387564421,
      "sparse_tokens": 32089.0,
      "step": 7383,
      "turn_loss": 0.135247603058815,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.34305891098308866,
      "grad_norm": 1.3221445083618164,
      "learning_rate": 3.286172383230388e-06,
      "loss": 0.2703,
      "mae_dtheta": 0.02762208692729473,
      "mae_dx": 0.004626271314918995,
      "mae_dy": 0.004619281738996506,
      "pose_mae_dtheta": 0.1920309066772461,
      "pose_mae_dx": 0.02821967378258705,
      "pose_mae_dy": 0.0762169286608696,
      "pose_rmse_dtheta": 0.3349086046218872,
      "pose_rmse_dx": 0.07348248362541199,
      "pose_rmse_dy": 0.15949618816375732,
      "pose_rmse_mean": 0.18929576873779297,
      "rmse_dtheta": 0.04436836764216423,
      "rmse_dx": 0.012978550046682358,
      "rmse_dy": 0.008012855425477028,
      "rmse_mean": 0.021786591038107872,
      "rotation_flip": 0.01413427572697401,
      "sparse_tokens": 6184.0,
      "step": 7384,
      "turn_loss": 0.19689048826694489,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.34310537074893144,
      "grad_norm": 0.5527210235595703,
      "learning_rate": 3.284930322765244e-06,
      "loss": 0.1332,
      "mae_dtheta": 0.022168422117829323,
      "mae_dx": 0.012145144864916801,
      "mae_dy": 0.0030812909826636314,
      "pose_mae_dtheta": 0.14706964790821075,
      "pose_mae_dx": 0.07665862888097763,
      "pose_mae_dy": 0.034758999943733215,
      "pose_rmse_dtheta": 0.2688860595226288,
      "pose_rmse_dx": 0.18447604775428772,
      "pose_rmse_dy": 0.09396913647651672,
      "pose_rmse_mean": 0.1824437379837036,
      "rmse_dtheta": 0.035514842718839645,
      "rmse_dx": 0.02560359053313732,
      "rmse_dy": 0.006101951003074646,
      "rmse_mean": 0.022406794130802155,
      "rotation_flip": 0.012765957042574883,
      "sparse_tokens": 10073.0,
      "step": 7385,
      "turn_loss": 0.1721460372209549,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3431518305147742,
      "grad_norm": 0.5142171382904053,
      "learning_rate": 3.2836883822358436e-06,
      "loss": 0.0739,
      "mae_dtheta": 0.008634183555841446,
      "mae_dx": 0.0014965564478188753,
      "mae_dy": 0.0015989472158253193,
      "pose_mae_dtheta": 0.05642665922641754,
      "pose_mae_dx": 0.018250711262226105,
      "pose_mae_dy": 0.022046413272619247,
      "pose_rmse_dtheta": 0.15466901659965515,
      "pose_rmse_dx": 0.043934907764196396,
      "pose_rmse_dy": 0.0539337582886219,
      "pose_rmse_mean": 0.08417923748493195,
      "rmse_dtheta": 0.021359777078032494,
      "rmse_dx": 0.005056678783148527,
      "rmse_dy": 0.0036234178114682436,
      "rmse_mean": 0.010013291612267494,
      "rotation_flip": 0.003865979379042983,
      "sparse_tokens": 32121.0,
      "step": 7386,
      "turn_loss": 0.07775536924600601,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.343198290280617,
      "grad_norm": 0.5734267830848694,
      "learning_rate": 3.282446561729035e-06,
      "loss": 0.14,
      "mae_dtheta": 0.008688864298164845,
      "mae_dx": 0.0013871422270312905,
      "mae_dy": 0.001258016680367291,
      "pose_mae_dtheta": 0.05841633304953575,
      "pose_mae_dx": 0.014194921590387821,
      "pose_mae_dy": 0.016458382830023766,
      "pose_rmse_dtheta": 0.1709514707326889,
      "pose_rmse_dx": 0.03607415780425072,
      "pose_rmse_dy": 0.04164925217628479,
      "pose_rmse_mean": 0.08289162814617157,
      "rmse_dtheta": 0.023307327181100845,
      "rmse_dx": 0.004171350505203009,
      "rmse_dy": 0.002864792011678219,
      "rmse_mean": 0.010114490054547787,
      "rotation_flip": 0.001990049844607711,
      "sparse_tokens": 32137.0,
      "step": 7387,
      "turn_loss": 0.06388732045888901,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.34324475004645977,
      "grad_norm": 0.5269774794578552,
      "learning_rate": 3.2812048613316593e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.02957761101424694,
      "mae_dx": 0.01144272182136774,
      "mae_dy": 0.0039010460022836924,
      "pose_mae_dtheta": 0.256330668926239,
      "pose_mae_dx": 0.10689588636159897,
      "pose_mae_dy": 0.062563456594944,
      "pose_rmse_dtheta": 0.5076712965965271,
      "pose_rmse_dx": 0.22955018281936646,
      "pose_rmse_dy": 0.16955605149269104,
      "pose_rmse_mean": 0.3022591769695282,
      "rmse_dtheta": 0.05075985938310623,
      "rmse_dx": 0.024009913206100464,
      "rmse_dy": 0.008725707419216633,
      "rmse_mean": 0.027831828221678734,
      "rotation_flip": 0.003683241317048669,
      "sparse_tokens": 11131.0,
      "step": 7388,
      "turn_loss": 0.17364104092121124,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.34329120981230254,
      "grad_norm": 0.5225071907043457,
      "learning_rate": 3.279963281130553e-06,
      "loss": 0.1101,
      "mae_dtheta": 0.035861726850271225,
      "mae_dx": 0.01038606371730566,
      "mae_dy": 0.005813069641590118,
      "pose_mae_dtheta": 0.2772830128669739,
      "pose_mae_dx": 0.08075083792209625,
      "pose_mae_dy": 0.04975663498044014,
      "pose_rmse_dtheta": 0.49110087752342224,
      "pose_rmse_dx": 0.17805209755897522,
      "pose_rmse_dy": 0.08414526283740997,
      "pose_rmse_mean": 0.2510994076728821,
      "rmse_dtheta": 0.05427736043930054,
      "rmse_dx": 0.021398143842816353,
      "rmse_dy": 0.00958205759525299,
      "rmse_mean": 0.028419187292456627,
      "rotation_flip": 0.01604278013110161,
      "sparse_tokens": 4243.0,
      "step": 7389,
      "turn_loss": 0.2687338888645172,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 33413.0,
      "epoch": 0.3433376695781453,
      "grad_norm": 0.4511023163795471,
      "learning_rate": 3.278721821212535e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.035365838557481766,
      "mae_dx": 0.013351052068173885,
      "mae_dy": 0.005778732243925333,
      "pose_mae_dtheta": 0.2638469934463501,
      "pose_mae_dx": 0.11028995364904404,
      "pose_mae_dy": 0.06744354218244553,
      "pose_rmse_dtheta": 0.4624297618865967,
      "pose_rmse_dx": 0.22876787185668945,
      "pose_rmse_dy": 0.13660287857055664,
      "pose_rmse_mean": 0.27593350410461426,
      "rmse_dtheta": 0.05401620268821716,
      "rmse_dx": 0.025768129155039787,
      "rmse_dy": 0.012029859237372875,
      "rmse_mean": 0.030604731291532516,
      "rotation_flip": 0.012618296779692173,
      "sparse_tokens": 23545.0,
      "step": 7390,
      "turn_loss": 0.28810685873031616,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3433841293439881,
      "grad_norm": 0.6464356184005737,
      "learning_rate": 3.2774804816644255e-06,
      "loss": 0.1751,
      "mae_dtheta": 0.010065283626317978,
      "mae_dx": 0.0017365784151479602,
      "mae_dy": 0.002838159678503871,
      "pose_mae_dtheta": 0.06822722405195236,
      "pose_mae_dx": 0.020351871848106384,
      "pose_mae_dy": 0.029263999313116074,
      "pose_rmse_dtheta": 0.17126020789146423,
      "pose_rmse_dx": 0.04947331175208092,
      "pose_rmse_dy": 0.07808665186166763,
      "pose_rmse_mean": 0.0996067225933075,
      "rmse_dtheta": 0.020159006118774414,
      "rmse_dx": 0.0042472900822758675,
      "rmse_dy": 0.006438653450459242,
      "rmse_mean": 0.010281650349497795,
      "rotation_flip": 0.007039774674922228,
      "sparse_tokens": 32121.0,
      "step": 7391,
      "turn_loss": 0.08503267168998718,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3434305891098309,
      "grad_norm": 0.3961851894855499,
      "learning_rate": 3.276239262573029e-06,
      "loss": 0.0859,
      "mae_dtheta": 0.006960728671401739,
      "mae_dx": 0.0009755009668879211,
      "mae_dy": 0.000903975625988096,
      "pose_mae_dtheta": 0.05056941881775856,
      "pose_mae_dx": 0.01067709643393755,
      "pose_mae_dy": 0.014766481705009937,
      "pose_rmse_dtheta": 0.18054328858852386,
      "pose_rmse_dx": 0.026104262098670006,
      "pose_rmse_dy": 0.03879952430725098,
      "pose_rmse_mean": 0.0818156898021698,
      "rmse_dtheta": 0.02072104811668396,
      "rmse_dx": 0.0029809835832566023,
      "rmse_dy": 0.0018292643362656236,
      "rmse_mean": 0.008510432206094265,
      "rotation_flip": 0.0024715769104659557,
      "sparse_tokens": 32121.0,
      "step": 7392,
      "turn_loss": 0.04823252186179161,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20451.0,
      "epoch": 0.34347704887567365,
      "grad_norm": 0.5034167766571045,
      "learning_rate": 3.274998164025148e-06,
      "loss": 0.1331,
      "mae_dtheta": 0.026073016226291656,
      "mae_dx": 0.009665759280323982,
      "mae_dy": 0.0039028783794492483,
      "pose_mae_dtheta": 0.19111579656600952,
      "pose_mae_dx": 0.0810910239815712,
      "pose_mae_dy": 0.06305509805679321,
      "pose_rmse_dtheta": 0.3746929168701172,
      "pose_rmse_dx": 0.21813610196113586,
      "pose_rmse_dy": 0.17534439265727997,
      "pose_rmse_mean": 0.2560577988624573,
      "rmse_dtheta": 0.043177422136068344,
      "rmse_dx": 0.02311757206916809,
      "rmse_dy": 0.008110701106488705,
      "rmse_mean": 0.02480190061032772,
      "rotation_flip": 0.01256281416863203,
      "sparse_tokens": 16194.0,
      "step": 7393,
      "turn_loss": 0.19410516321659088,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.34352350864151643,
      "grad_norm": 0.5902461409568787,
      "learning_rate": 3.2737571861075696e-06,
      "loss": 0.1515,
      "mae_dtheta": 0.02986808493733406,
      "mae_dx": 0.010029626078903675,
      "mae_dy": 0.0056718578562140465,
      "pose_mae_dtheta": 0.24365296959877014,
      "pose_mae_dx": 0.07336116582155228,
      "pose_mae_dy": 0.06502670794725418,
      "pose_rmse_dtheta": 0.40333911776542664,
      "pose_rmse_dx": 0.1979636251926422,
      "pose_rmse_dy": 0.16274534165859222,
      "pose_rmse_mean": 0.254682719707489,
      "rmse_dtheta": 0.04447523131966591,
      "rmse_dx": 0.022766131907701492,
      "rmse_dy": 0.009862525388598442,
      "rmse_mean": 0.02570129744708538,
      "rotation_flip": 0.021551724523305893,
      "sparse_tokens": 3623.0,
      "step": 7394,
      "turn_loss": 0.21413391828536987,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3435699684073592,
      "grad_norm": 0.5859096050262451,
      "learning_rate": 3.2725163289070774e-06,
      "loss": 0.0904,
      "mae_dtheta": 0.0057224733754992485,
      "mae_dx": 0.002638657810166478,
      "mae_dy": 0.0011019041994586587,
      "pose_mae_dtheta": 0.04021807760000229,
      "pose_mae_dx": 0.023642858490347862,
      "pose_mae_dy": 0.014081346802413464,
      "pose_rmse_dtheta": 0.12893474102020264,
      "pose_rmse_dx": 0.09672155231237411,
      "pose_rmse_dy": 0.03532690554857254,
      "pose_rmse_mean": 0.08699440211057663,
      "rmse_dtheta": 0.01673520915210247,
      "rmse_dx": 0.010311068966984749,
      "rmse_dy": 0.002820418681949377,
      "rmse_mean": 0.009955566376447678,
      "rotation_flip": 0.005400539841502905,
      "sparse_tokens": 32057.0,
      "step": 7395,
      "turn_loss": 0.059704650193452835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.343616428173202,
      "grad_norm": 0.3509504199028015,
      "learning_rate": 3.2712755925104478e-06,
      "loss": 0.0597,
      "mae_dtheta": 0.007246889173984528,
      "mae_dx": 0.0012797651579603553,
      "mae_dy": 0.0011075307847931981,
      "pose_mae_dtheta": 0.05121699348092079,
      "pose_mae_dx": 0.012088172137737274,
      "pose_mae_dy": 0.012476476840674877,
      "pose_rmse_dtheta": 0.1791394203901291,
      "pose_rmse_dx": 0.033783599734306335,
      "pose_rmse_dy": 0.034084614366292953,
      "pose_rmse_mean": 0.08233588188886642,
      "rmse_dtheta": 0.021334420889616013,
      "rmse_dx": 0.0043799965642392635,
      "rmse_dy": 0.002783276606351137,
      "rmse_mean": 0.009499231353402138,
      "rotation_flip": 0.004599816165864468,
      "sparse_tokens": 32169.0,
      "step": 7396,
      "turn_loss": 0.05432965233922005,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3436628879390448,
      "grad_norm": 0.4609999656677246,
      "learning_rate": 3.2700349770044416e-06,
      "loss": 0.1088,
      "mae_dtheta": 0.011589379981160164,
      "mae_dx": 0.001920592156238854,
      "mae_dy": 0.0021053720265626907,
      "pose_mae_dtheta": 0.08097025007009506,
      "pose_mae_dx": 0.022872349247336388,
      "pose_mae_dy": 0.020631568506360054,
      "pose_rmse_dtheta": 0.22214524447917938,
      "pose_rmse_dx": 0.05500010401010513,
      "pose_rmse_dy": 0.04770440608263016,
      "pose_rmse_mean": 0.10828325152397156,
      "rmse_dtheta": 0.02735118381679058,
      "rmse_dx": 0.005119859240949154,
      "rmse_dy": 0.004654372110962868,
      "rmse_mean": 0.012375138700008392,
      "rotation_flip": 0.004206500947475433,
      "sparse_tokens": 32153.0,
      "step": 7397,
      "turn_loss": 0.0848119705915451,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3437093477048876,
      "grad_norm": 0.5404725670814514,
      "learning_rate": 3.26879448247582e-06,
      "loss": 0.1029,
      "mae_dtheta": 0.00859074480831623,
      "mae_dx": 0.0015985243953764439,
      "mae_dy": 0.001008963561616838,
      "pose_mae_dtheta": 0.06071649119257927,
      "pose_mae_dx": 0.014609595760703087,
      "pose_mae_dy": 0.016469299793243408,
      "pose_rmse_dtheta": 0.1858121007680893,
      "pose_rmse_dx": 0.035927508026361465,
      "pose_rmse_dy": 0.05120774358510971,
      "pose_rmse_mean": 0.09098245203495026,
      "rmse_dtheta": 0.024568069726228714,
      "rmse_dx": 0.004895892925560474,
      "rmse_dy": 0.002632186282426119,
      "rmse_mean": 0.010698716156184673,
      "rotation_flip": 0.00479744141921401,
      "sparse_tokens": 32137.0,
      "step": 7398,
      "turn_loss": 0.057009339332580566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.34375580747073037,
      "grad_norm": 0.4001184105873108,
      "learning_rate": 3.267554109011327e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.008905552327632904,
      "mae_dx": 0.0015112276887521148,
      "mae_dy": 0.0015107187209650874,
      "pose_mae_dtheta": 0.059835419058799744,
      "pose_mae_dx": 0.015193999744951725,
      "pose_mae_dy": 0.019561927765607834,
      "pose_rmse_dtheta": 0.1785499006509781,
      "pose_rmse_dx": 0.03280999884009361,
      "pose_rmse_dy": 0.04340077191591263,
      "pose_rmse_mean": 0.08492022752761841,
      "rmse_dtheta": 0.021742111071944237,
      "rmse_dx": 0.0044790152460336685,
      "rmse_dy": 0.003489257302135229,
      "rmse_mean": 0.009903461672365665,
      "rotation_flip": 0.004913076292723417,
      "sparse_tokens": 32121.0,
      "step": 7399,
      "turn_loss": 0.06792811304330826,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.34380226723657314,
      "grad_norm": 0.5742238163948059,
      "learning_rate": 3.2663138566977064e-06,
      "loss": 0.1693,
      "mae_dtheta": 0.0352465845644474,
      "mae_dx": 0.0069062914699316025,
      "mae_dy": 0.0034093372523784637,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5742239356040955,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 131.32394409179688,
      "model/head/act_norm_mean": 102.73271122685185,
      "model/head/act_norm_min": 85.89382934570312,
      "model/head/act_over_embed": 70.59888095388848,
      "model/head/grad_frac": 0.12209344655275345,
      "model/head/grad_norm": 0.07010897994041443,
      "model/head/grad_zero_frac": 0.0001465795503463596,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6936848958333334,
      "model/head/update_ratio": 0.0011952165514230728,
      "model/head/weight_delta": 9.520376205444336,
      "model/head/weight_delta_rel": 0.16701559722423553,
      "model/head/weight_norm": 58.6579704284668,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4220041036605835,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4220041036605835,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4220041036605835,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2900051709002183,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07373782247304916,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04234202206134796,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013675900408998132,
      "model/modality_embedder.encoders.pose/weight_delta": 3.056471109390259,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09986443817615509,
      "model/modality_embedder.encoders.pose/weight_norm": 30.961048126220703,
      "model/modality_embedder/grad_frac": 0.07373782247304916,
      "model/modality_embedder/grad_norm": 0.04234202206134796,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0013675900408998132,
      "model/modality_embedder/weight_delta": 3.056471109390259,
      "model/modality_embedder/weight_delta_rel": 0.09986443817615509,
      "model/modality_embedder/weight_norm": 30.961048126220703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 63.80415725708008,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.987941376396236,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.178915977478027,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.79752853035745,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06048763543367386,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.034733448177576065,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012444120366126299,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5183308124542236,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0917694941163063,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.91153335571289,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 64.99958038330078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.79838835611405,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.878348350524902,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.3544752823437,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06542861461639404,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03757067769765854,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012654123129323125,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.1951494216918945,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11068247258663177,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.69046401977539,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 66.44119262695312,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.43871711493239,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.035209655761719,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.481724562403457,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06132442131638527,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03521395102143288,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00031270174076780677,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011486568255349994,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.4502508640289307,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1158529669046402,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.656633377075195,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 66.98185729980469,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.30840544165197,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.585766792297363,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.76659188482305,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.055422015488147736,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03182464838027954,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010647381423041224,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.9529123306274414,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10091652721166611,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.8896484375,
      "model/normalizer/grad_frac": 0.19994927942752838,
      "model/normalizer/grad_norm": 0.11481565982103348,
      "model/normalizer/grad_zero_frac": 0.00025525549426674843,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014613574603572488,
      "model/normalizer/weight_delta": 6.238937854766846,
      "model/normalizer/weight_delta_rel": 0.08035390824079514,
      "model/normalizer/weight_norm": 78.56781005859375,
      "pose_mae_dtheta": 0.30296874046325684,
      "pose_mae_dx": 0.053562406450510025,
      "pose_mae_dy": 0.04053115472197533,
      "pose_rmse_dtheta": 0.5205446481704712,
      "pose_rmse_dx": 0.16539116203784943,
      "pose_rmse_dy": 0.08860611915588379,
      "pose_rmse_mean": 0.2581806480884552,
      "rmse_dtheta": 0.05272065848112106,
      "rmse_dx": 0.017347265034914017,
      "rmse_dy": 0.006671121343970299,
      "rmse_mean": 0.025579683482646942,
      "rotation_flip": 0.017094017937779427,
      "sparse_tokens": 6896.0,
      "step": 7400,
      "turn_loss": 0.24422894418239594,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "epoch": 0.34380226723657314,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30737894773483276,
      "eval_objectnav_nopose_mae_dtheta": 0.04037313908338547,
      "eval_objectnav_nopose_mae_dx": 0.012943915091454983,
      "eval_objectnav_nopose_mae_dy": 0.004897489212453365,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3258078396320343,
      "eval_objectnav_nopose_pose_mae_dx": 0.10311129689216614,
      "eval_objectnav_nopose_pose_mae_dy": 0.05519024655222893,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5544861555099487,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22903095185756683,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13183706998825073,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3051180839538574,
      "eval_objectnav_nopose_rmse_dtheta": 0.05852590128779411,
      "eval_objectnav_nopose_rmse_dx": 0.025616785511374474,
      "eval_objectnav_nopose_rmse_dy": 0.01008946355432272,
      "eval_objectnav_nopose_rmse_mean": 0.031410716474056244,
      "eval_objectnav_nopose_rotation_flip": 0.015179365873336792,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30737894773483276,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 7400
    },
    {
      "epoch": 0.34380226723657314,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27595606446266174,
      "eval_objectnav_pose_mae_dtheta": 0.03543248400092125,
      "eval_objectnav_pose_mae_dx": 0.01105104386806488,
      "eval_objectnav_pose_mae_dy": 0.00445588119328022,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2658049464225769,
      "eval_objectnav_pose_pose_mae_dx": 0.08590999990701675,
      "eval_objectnav_pose_pose_mae_dy": 0.04739203304052353,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46833592653274536,
      "eval_objectnav_pose_pose_rmse_dx": 0.2008366882801056,
      "eval_objectnav_pose_pose_rmse_dy": 0.11648625880479813,
      "eval_objectnav_pose_pose_rmse_mean": 0.2618862986564636,
      "eval_objectnav_pose_rmse_dtheta": 0.05345255881547928,
      "eval_objectnav_pose_rmse_dx": 0.0232881810516119,
      "eval_objectnav_pose_rmse_dy": 0.009314575232565403,
      "eval_objectnav_pose_rmse_mean": 0.028685105964541435,
      "eval_objectnav_pose_rotation_flip": 0.015703825280070305,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27595606446266174,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 7400
    },
    {
      "epoch": 0.34380226723657314,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.0893096998333931,
      "eval_pointnav_mae_dtheta": 0.010108566842973232,
      "eval_pointnav_mae_dx": 0.00233183684758842,
      "eval_pointnav_mae_dy": 0.0023706681095063686,
      "eval_pointnav_pose_mae_dtheta": 0.06933814287185669,
      "eval_pointnav_pose_mae_dx": 0.025840744376182556,
      "eval_pointnav_pose_mae_dy": 0.02536904066801071,
      "eval_pointnav_pose_rmse_dtheta": 0.198274165391922,
      "eval_pointnav_pose_rmse_dx": 0.07886616885662079,
      "eval_pointnav_pose_rmse_dy": 0.07316310703754425,
      "eval_pointnav_pose_rmse_mean": 0.11676780879497528,
      "eval_pointnav_rmse_dtheta": 0.02507620118558407,
      "eval_pointnav_rmse_dx": 0.007406516000628471,
      "eval_pointnav_rmse_dy": 0.006377239245921373,
      "eval_pointnav_rmse_mean": 0.012953318655490875,
      "eval_pointnav_rotation_flip": 0.005719801876693964,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.0893096998333931,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 7400
    },
    {
      "epoch": 0.34380226723657314,
      "eval_loss": 0.22421490401029587,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30737894773483276,
      "eval_objectnav_nopose_mae_dtheta": 0.04037313908338547,
      "eval_objectnav_nopose_mae_dx": 0.012943915091454983,
      "eval_objectnav_nopose_mae_dy": 0.004897489212453365,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3258078396320343,
      "eval_objectnav_nopose_pose_mae_dx": 0.10311129689216614,
      "eval_objectnav_nopose_pose_mae_dy": 0.05519024655222893,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5544861555099487,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22903095185756683,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13183706998825073,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3051180839538574,
      "eval_objectnav_nopose_rmse_dtheta": 0.05852590128779411,
      "eval_objectnav_nopose_rmse_dx": 0.025616785511374474,
      "eval_objectnav_nopose_rmse_dy": 0.01008946355432272,
      "eval_objectnav_nopose_rmse_mean": 0.031410716474056244,
      "eval_objectnav_nopose_rotation_flip": 0.015179365873336792,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30737894773483276,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27595606446266174,
      "eval_objectnav_pose_mae_dtheta": 0.03543248400092125,
      "eval_objectnav_pose_mae_dx": 0.01105104386806488,
      "eval_objectnav_pose_mae_dy": 0.00445588119328022,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2658049464225769,
      "eval_objectnav_pose_pose_mae_dx": 0.08590999990701675,
      "eval_objectnav_pose_pose_mae_dy": 0.04739203304052353,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46833592653274536,
      "eval_objectnav_pose_pose_rmse_dx": 0.2008366882801056,
      "eval_objectnav_pose_pose_rmse_dy": 0.11648625880479813,
      "eval_objectnav_pose_pose_rmse_mean": 0.2618862986564636,
      "eval_objectnav_pose_rmse_dtheta": 0.05345255881547928,
      "eval_objectnav_pose_rmse_dx": 0.0232881810516119,
      "eval_objectnav_pose_rmse_dy": 0.009314575232565403,
      "eval_objectnav_pose_rmse_mean": 0.028685105964541435,
      "eval_objectnav_pose_rotation_flip": 0.015703825280070305,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27595606446266174,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.0893096998333931,
      "eval_pointnav_mae_dtheta": 0.010108566842973232,
      "eval_pointnav_mae_dx": 0.00233183684758842,
      "eval_pointnav_mae_dy": 0.0023706681095063686,
      "eval_pointnav_pose_mae_dtheta": 0.06933814287185669,
      "eval_pointnav_pose_mae_dx": 0.025840744376182556,
      "eval_pointnav_pose_mae_dy": 0.02536904066801071,
      "eval_pointnav_pose_rmse_dtheta": 0.198274165391922,
      "eval_pointnav_pose_rmse_dx": 0.07886616885662079,
      "eval_pointnav_pose_rmse_dy": 0.07316310703754425,
      "eval_pointnav_pose_rmse_mean": 0.11676780879497528,
      "eval_pointnav_rmse_dtheta": 0.02507620118558407,
      "eval_pointnav_rmse_dx": 0.007406516000628471,
      "eval_pointnav_rmse_dy": 0.006377239245921373,
      "eval_pointnav_rmse_mean": 0.012953318655490875,
      "eval_pointnav_rotation_flip": 0.005719801876693964,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.0893096998333931,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 7400
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3438487270024159,
      "grad_norm": 0.495083212852478,
      "learning_rate": 3.2650737256216885e-06,
      "loss": 0.0799,
      "mae_dtheta": 0.005370401777327061,
      "mae_dx": 0.001379232737235725,
      "mae_dy": 0.0011946448357775807,
      "pose_mae_dtheta": 0.03894883766770363,
      "pose_mae_dx": 0.012749194167554379,
      "pose_mae_dy": 0.013759179972112179,
      "pose_rmse_dtheta": 0.10392950475215912,
      "pose_rmse_dx": 0.0472806878387928,
      "pose_rmse_dy": 0.03568310663104057,
      "pose_rmse_mean": 0.0622977688908577,
      "rmse_dtheta": 0.015466895885765553,
      "rmse_dx": 0.004835719708353281,
      "rmse_dy": 0.003983980510383844,
      "rmse_mean": 0.008095532655715942,
      "rotation_flip": 0.0029097963124513626,
      "sparse_tokens": 32169.0,
      "step": 7401,
      "turn_loss": 0.05103987827897072,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.3438951867682587,
      "grad_norm": 0.5512427687644958,
      "learning_rate": 3.263833715869996e-06,
      "loss": 0.1213,
      "mae_dtheta": 0.006733683403581381,
      "mae_dx": 0.001461611595004797,
      "mae_dy": 0.00023940390383359045,
      "pose_mae_dtheta": 0.04838533699512482,
      "pose_mae_dx": 0.011463661678135395,
      "pose_mae_dy": 0.0034052724950015545,
      "pose_rmse_dtheta": 0.2144729495048523,
      "pose_rmse_dx": 0.025839896872639656,
      "pose_rmse_dy": 0.009099837392568588,
      "pose_rmse_mean": 0.08313756436109543,
      "rmse_dtheta": 0.025933843106031418,
      "rmse_dx": 0.0038807629607617855,
      "rmse_dy": 0.0005191171076148748,
      "rmse_mean": 0.010111241601407528,
      "rotation_flip": 0.0010272213257849216,
      "sparse_tokens": 32265.0,
      "step": 7402,
      "turn_loss": 0.050907112658023834,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3439416465341015,
      "grad_norm": 0.46141213178634644,
      "learning_rate": 3.2625938275293436e-06,
      "loss": 0.0993,
      "mae_dtheta": 0.008125639520585537,
      "mae_dx": 0.001897855312563479,
      "mae_dy": 0.001577875460498035,
      "pose_mae_dtheta": 0.06120665743947029,
      "pose_mae_dx": 0.013304638676345348,
      "pose_mae_dy": 0.015222905203700066,
      "pose_rmse_dtheta": 0.19502922892570496,
      "pose_rmse_dx": 0.03549946844577789,
      "pose_rmse_dy": 0.04016897454857826,
      "pose_rmse_mean": 0.09023256599903107,
      "rmse_dtheta": 0.021721655502915382,
      "rmse_dx": 0.006131854839622974,
      "rmse_dy": 0.0052045369520783424,
      "rmse_mean": 0.011019349098205566,
      "rotation_flip": 0.005135387647897005,
      "sparse_tokens": 32169.0,
      "step": 7403,
      "turn_loss": 0.06597872823476791,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.34398810629994425,
      "grad_norm": 0.2712953984737396,
      "learning_rate": 3.2613540606864376e-06,
      "loss": 0.0628,
      "mae_dtheta": 0.006670839618891478,
      "mae_dx": 0.0011942333076149225,
      "mae_dy": 0.0021043953020125628,
      "pose_mae_dtheta": 0.040118586272001266,
      "pose_mae_dx": 0.01865456812083721,
      "pose_mae_dy": 0.02093089558184147,
      "pose_rmse_dtheta": 0.07779394090175629,
      "pose_rmse_dx": 0.05255566164851189,
      "pose_rmse_dy": 0.04760877043008804,
      "pose_rmse_mean": 0.05931945890188217,
      "rmse_dtheta": 0.01434427872300148,
      "rmse_dx": 0.0034659102093428373,
      "rmse_dy": 0.00491318479180336,
      "rmse_mean": 0.007574457675218582,
      "rotation_flip": 0.005321326199918985,
      "sparse_tokens": 32057.0,
      "step": 7404,
      "turn_loss": 0.06507349759340286,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.34403456606578703,
      "grad_norm": 0.5348377227783203,
      "learning_rate": 3.260114415427975e-06,
      "loss": 0.1158,
      "mae_dtheta": 0.027176711708307266,
      "mae_dx": 0.005745995789766312,
      "mae_dy": 0.0026791486889123917,
      "pose_mae_dtheta": 0.18937984108924866,
      "pose_mae_dx": 0.04099097475409508,
      "pose_mae_dy": 0.035864606499671936,
      "pose_rmse_dtheta": 0.3976856768131256,
      "pose_rmse_dx": 0.10814234614372253,
      "pose_rmse_dy": 0.08650851249694824,
      "pose_rmse_mean": 0.19744551181793213,
      "rmse_dtheta": 0.04931635409593582,
      "rmse_dx": 0.015124346129596233,
      "rmse_dy": 0.006153075024485588,
      "rmse_mean": 0.02353125810623169,
      "rotation_flip": 0.0,
      "sparse_tokens": 5470.0,
      "step": 7405,
      "turn_loss": 0.18394456803798676,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3440810258316298,
      "grad_norm": 0.47752314805984497,
      "learning_rate": 3.2588748918406454e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.0059242453426122665,
      "mae_dx": 0.0008824439137242734,
      "mae_dy": 0.0005562010919675231,
      "pose_mae_dtheta": 0.042757876217365265,
      "pose_mae_dx": 0.006684197578579187,
      "pose_mae_dy": 0.00797899067401886,
      "pose_rmse_dtheta": 0.18572694063186646,
      "pose_rmse_dx": 0.01780768111348152,
      "pose_rmse_dy": 0.020860526710748672,
      "pose_rmse_mean": 0.07479838281869888,
      "rmse_dtheta": 0.02161869779229164,
      "rmse_dx": 0.002873303135856986,
      "rmse_dy": 0.0016603387193754315,
      "rmse_mean": 0.008717447519302368,
      "rotation_flip": 0.0013440860202535987,
      "sparse_tokens": 32121.0,
      "step": 7406,
      "turn_loss": 0.03327672928571701,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.3441274855974726,
      "grad_norm": 0.5382460951805115,
      "learning_rate": 3.257635490011128e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.03131381422281265,
      "mae_dx": 0.007653189357370138,
      "mae_dy": 0.0031301595736294985,
      "pose_mae_dtheta": 0.2463981658220291,
      "pose_mae_dx": 0.06403645128011703,
      "pose_mae_dy": 0.032762810587882996,
      "pose_rmse_dtheta": 0.49938324093818665,
      "pose_rmse_dx": 0.16431140899658203,
      "pose_rmse_dy": 0.09023920446634293,
      "pose_rmse_mean": 0.2513113021850586,
      "rmse_dtheta": 0.05231432989239693,
      "rmse_dx": 0.018610471859574318,
      "rmse_dy": 0.008014030754566193,
      "rmse_mean": 0.026312945410609245,
      "rotation_flip": 0.016719745472073555,
      "sparse_tokens": 19961.0,
      "step": 7407,
      "turn_loss": 0.18933558464050293,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.34417394536331536,
      "grad_norm": 0.48675963282585144,
      "learning_rate": 3.2563962100260982e-06,
      "loss": 0.172,
      "mae_dtheta": 0.03107445128262043,
      "mae_dx": 0.006446691229939461,
      "mae_dy": 0.004249034449458122,
      "pose_mae_dtheta": 0.23289048671722412,
      "pose_mae_dx": 0.05033663660287857,
      "pose_mae_dy": 0.05399208143353462,
      "pose_rmse_dtheta": 0.45737066864967346,
      "pose_rmse_dx": 0.10148350149393082,
      "pose_rmse_dy": 0.10464499890804291,
      "pose_rmse_mean": 0.22116640210151672,
      "rmse_dtheta": 0.05051848292350769,
      "rmse_dx": 0.015806684270501137,
      "rmse_dy": 0.006873322185128927,
      "rmse_mean": 0.024399496614933014,
      "rotation_flip": 0.007312614470720291,
      "sparse_tokens": 9500.0,
      "step": 7408,
      "turn_loss": 0.22074390947818756,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.34422040512915814,
      "grad_norm": 1.3336458206176758,
      "learning_rate": 3.2551570519722155e-06,
      "loss": 0.2845,
      "mae_dtheta": 0.036323122680187225,
      "mae_dx": 0.012328810058534145,
      "mae_dy": 0.007342663127928972,
      "pose_mae_dtheta": 0.3030681908130646,
      "pose_mae_dx": 0.11157616972923279,
      "pose_mae_dy": 0.08192519098520279,
      "pose_rmse_dtheta": 0.5172565579414368,
      "pose_rmse_dx": 0.2437768280506134,
      "pose_rmse_dy": 0.16037806868553162,
      "pose_rmse_mean": 0.3071371912956238,
      "rmse_dtheta": 0.05574816092848778,
      "rmse_dx": 0.02437041513621807,
      "rmse_dy": 0.013900792226195335,
      "rmse_mean": 0.03133979067206383,
      "rotation_flip": 0.01785714365541935,
      "sparse_tokens": 7823.0,
      "step": 7409,
      "turn_loss": 0.2914799451828003,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3442668648950009,
      "grad_norm": 0.5937526822090149,
      "learning_rate": 3.253918015936138e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.01024692039936781,
      "mae_dx": 0.0019344812026247382,
      "mae_dy": 0.002208665246143937,
      "pose_mae_dtheta": 0.07290536165237427,
      "pose_mae_dx": 0.024565942585468292,
      "pose_mae_dy": 0.032091617584228516,
      "pose_rmse_dtheta": 0.19048869609832764,
      "pose_rmse_dx": 0.06686606258153915,
      "pose_rmse_dy": 0.08227644860744476,
      "pose_rmse_mean": 0.11321040242910385,
      "rmse_dtheta": 0.02239074371755123,
      "rmse_dx": 0.006594569887965918,
      "rmse_dy": 0.005021845921874046,
      "rmse_mean": 0.011335721239447594,
      "rotation_flip": 0.0028395645786076784,
      "sparse_tokens": 32057.0,
      "step": 7410,
      "turn_loss": 0.08866293728351593,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3443133246608437,
      "grad_norm": 0.5642902851104736,
      "learning_rate": 3.252679102004509e-06,
      "loss": 0.1447,
      "mae_dtheta": 0.0067557888105511665,
      "mae_dx": 0.0015525774797424674,
      "mae_dy": 0.0009606346720829606,
      "pose_mae_dtheta": 0.05255876109004021,
      "pose_mae_dx": 0.015295659191906452,
      "pose_mae_dy": 0.010714664123952389,
      "pose_rmse_dtheta": 0.20108294486999512,
      "pose_rmse_dx": 0.039080578833818436,
      "pose_rmse_dy": 0.03371158987283707,
      "pose_rmse_mean": 0.09129171073436737,
      "rmse_dtheta": 0.02161507122218609,
      "rmse_dx": 0.004495108500123024,
      "rmse_dy": 0.0030882013961672783,
      "rmse_mean": 0.009732794016599655,
      "rotation_flip": 0.002319109393283725,
      "sparse_tokens": 32201.0,
      "step": 7411,
      "turn_loss": 0.047018345445394516,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.34435978442668647,
      "grad_norm": 0.5508936047554016,
      "learning_rate": 3.2514403102639704e-06,
      "loss": 0.115,
      "mae_dtheta": 0.03503243625164032,
      "mae_dx": 0.012213283218443394,
      "mae_dy": 0.006375489290803671,
      "pose_mae_dtheta": 0.2892530560493469,
      "pose_mae_dx": 0.09334196150302887,
      "pose_mae_dy": 0.06902939081192017,
      "pose_rmse_dtheta": 0.542583703994751,
      "pose_rmse_dx": 0.2157362401485443,
      "pose_rmse_dy": 0.19533023238182068,
      "pose_rmse_mean": 0.3178834319114685,
      "rmse_dtheta": 0.05696515738964081,
      "rmse_dx": 0.024195505306124687,
      "rmse_dy": 0.016212880611419678,
      "rmse_mean": 0.032457850873470306,
      "rotation_flip": 0.006675567477941513,
      "sparse_tokens": 13142.0,
      "step": 7412,
      "turn_loss": 0.2960730493068695,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.34440624419252924,
      "grad_norm": 0.45976296067237854,
      "learning_rate": 3.2502016408011473e-06,
      "loss": 0.1004,
      "mae_dtheta": 0.010887373238801956,
      "mae_dx": 0.0028517458122223616,
      "mae_dy": 0.004222524352371693,
      "pose_mae_dtheta": 0.0802106037735939,
      "pose_mae_dx": 0.039267346262931824,
      "pose_mae_dy": 0.03522426635026932,
      "pose_rmse_dtheta": 0.17889386415481567,
      "pose_rmse_dx": 0.12060514837503433,
      "pose_rmse_dy": 0.09720144420862198,
      "pose_rmse_mean": 0.13223348557949066,
      "rmse_dtheta": 0.022271154448390007,
      "rmse_dx": 0.006914359983056784,
      "rmse_dy": 0.010014524683356285,
      "rmse_mean": 0.013066679239273071,
      "rotation_flip": 0.006247702986001968,
      "sparse_tokens": 32121.0,
      "step": 7413,
      "turn_loss": 0.10285207629203796,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3444527039583721,
      "grad_norm": 0.7155507802963257,
      "learning_rate": 3.248963093702663e-06,
      "loss": 0.1307,
      "mae_dtheta": 0.008320823311805725,
      "mae_dx": 0.0011937129311263561,
      "mae_dy": 0.0002306686365045607,
      "pose_mae_dtheta": 0.05956944078207016,
      "pose_mae_dx": 0.009107097052037716,
      "pose_mae_dy": 0.002768533769994974,
      "pose_rmse_dtheta": 0.2590758800506592,
      "pose_rmse_dx": 0.022105135023593903,
      "pose_rmse_dy": 0.0051430752500891685,
      "pose_rmse_mean": 0.09544136375188828,
      "rmse_dtheta": 0.03051127679646015,
      "rmse_dx": 0.0036942767910659313,
      "rmse_dy": 0.0007519689970649779,
      "rmse_mean": 0.01165250688791275,
      "rotation_flip": 0.0006557377055287361,
      "sparse_tokens": 32185.0,
      "step": 7414,
      "turn_loss": 0.04276198148727417,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.34449916372421485,
      "grad_norm": 0.6982268691062927,
      "learning_rate": 3.2477246690551307e-06,
      "loss": 0.1586,
      "mae_dtheta": 0.009168624877929688,
      "mae_dx": 0.001458190381526947,
      "mae_dy": 0.0021960102021694183,
      "pose_mae_dtheta": 0.06301776319742203,
      "pose_mae_dx": 0.01909562572836876,
      "pose_mae_dy": 0.027040250599384308,
      "pose_rmse_dtheta": 0.1371089667081833,
      "pose_rmse_dx": 0.05072852969169617,
      "pose_rmse_dy": 0.05930318683385849,
      "pose_rmse_mean": 0.08238022774457932,
      "rmse_dtheta": 0.01947791315615177,
      "rmse_dx": 0.004265611059963703,
      "rmse_dy": 0.0048785083927214146,
      "rmse_mean": 0.00954067800194025,
      "rotation_flip": 0.003346080193296075,
      "sparse_tokens": 32073.0,
      "step": 7415,
      "turn_loss": 0.08321606367826462,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.34454562349005763,
      "grad_norm": 0.4818946123123169,
      "learning_rate": 3.2464863669451508e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.04191752150654793,
      "mae_dx": 0.011550608091056347,
      "mae_dy": 0.005287527572363615,
      "pose_mae_dtheta": 0.3562454879283905,
      "pose_mae_dx": 0.08930359780788422,
      "pose_mae_dy": 0.055168114602565765,
      "pose_rmse_dtheta": 0.6061698198318481,
      "pose_rmse_dx": 0.20381537079811096,
      "pose_rmse_dy": 0.12754349410533905,
      "pose_rmse_mean": 0.31250956654548645,
      "rmse_dtheta": 0.06045626476407051,
      "rmse_dx": 0.0239323228597641,
      "rmse_dy": 0.010150250047445297,
      "rmse_mean": 0.031512945890426636,
      "rotation_flip": 0.00937500037252903,
      "sparse_tokens": 11992.0,
      "step": 7416,
      "turn_loss": 0.23950918018817902,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.3445920832559004,
      "grad_norm": 0.4325040876865387,
      "learning_rate": 3.2452481874593234e-06,
      "loss": 0.0973,
      "mae_dtheta": 0.0421232134103775,
      "mae_dx": 0.010376705788075924,
      "mae_dy": 0.003817096585407853,
      "pose_mae_dtheta": 0.3216182589530945,
      "pose_mae_dx": 0.08777591586112976,
      "pose_mae_dy": 0.0431654155254364,
      "pose_rmse_dtheta": 0.5144093632698059,
      "pose_rmse_dx": 0.18712519109249115,
      "pose_rmse_dy": 0.10058390349149704,
      "pose_rmse_mean": 0.26737284660339355,
      "rmse_dtheta": 0.05859820172190666,
      "rmse_dx": 0.021402902901172638,
      "rmse_dy": 0.007895619608461857,
      "rmse_mean": 0.02929890714585781,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 15626.0,
      "step": 7417,
      "turn_loss": 0.3579677641391754,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 8116.0,
      "epoch": 0.3446385430217432,
      "grad_norm": 0.6606528162956238,
      "learning_rate": 3.2440101306842293e-06,
      "loss": 0.1124,
      "mae_dtheta": 0.03480322286486626,
      "mae_dx": 0.02001406066119671,
      "mae_dy": 0.009033181704580784,
      "pose_mae_dtheta": 0.2806450426578522,
      "pose_mae_dx": 0.16535213589668274,
      "pose_mae_dy": 0.08553147315979004,
      "pose_rmse_dtheta": 0.4124137759208679,
      "pose_rmse_dx": 0.3265550434589386,
      "pose_rmse_dy": 0.1568482369184494,
      "pose_rmse_mean": 0.29860571026802063,
      "rmse_dtheta": 0.04979395493865013,
      "rmse_dx": 0.034063056111335754,
      "rmse_dy": 0.014520314522087574,
      "rmse_mean": 0.03279244527220726,
      "rotation_flip": 0.012048192322254181,
      "sparse_tokens": 6331.0,
      "step": 7418,
      "turn_loss": 0.46343693137168884,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.34468500278758596,
      "grad_norm": 0.4151116907596588,
      "learning_rate": 3.2427721967064505e-06,
      "loss": 0.082,
      "mae_dtheta": 0.00979034136980772,
      "mae_dx": 0.0016319080023095012,
      "mae_dy": 0.002294916892424226,
      "pose_mae_dtheta": 0.060737062245607376,
      "pose_mae_dx": 0.018284885212779045,
      "pose_mae_dy": 0.024867208674550056,
      "pose_rmse_dtheta": 0.15357409417629242,
      "pose_rmse_dx": 0.04765931889414787,
      "pose_rmse_dy": 0.057263411581516266,
      "pose_rmse_mean": 0.08616560697555542,
      "rmse_dtheta": 0.021354805678129196,
      "rmse_dx": 0.004773878958076239,
      "rmse_dy": 0.005110889673233032,
      "rmse_mean": 0.010413192212581635,
      "rotation_flip": 0.004741064738482237,
      "sparse_tokens": 32105.0,
      "step": 7419,
      "turn_loss": 0.09139862656593323,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.34473146255342874,
      "grad_norm": 0.5994875431060791,
      "learning_rate": 3.2415343856125547e-06,
      "loss": 0.1601,
      "mae_dtheta": 0.0319163016974926,
      "mae_dx": 0.011848566122353077,
      "mae_dy": 0.006261617876589298,
      "pose_mae_dtheta": 0.2325815111398697,
      "pose_mae_dx": 0.10049992799758911,
      "pose_mae_dy": 0.09776316583156586,
      "pose_rmse_dtheta": 0.41652193665504456,
      "pose_rmse_dx": 0.24232402443885803,
      "pose_rmse_dy": 0.20022252202033997,
      "pose_rmse_mean": 0.2863561809062958,
      "rmse_dtheta": 0.04762893170118332,
      "rmse_dx": 0.026076840236783028,
      "rmse_dy": 0.010509918443858624,
      "rmse_mean": 0.028071895241737366,
      "rotation_flip": 0.009291521273553371,
      "sparse_tokens": 13858.0,
      "step": 7420,
      "turn_loss": 0.24878907203674316,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 32339.0,
      "epoch": 0.3447779223192715,
      "grad_norm": 0.599760890007019,
      "learning_rate": 3.240296697489104e-06,
      "loss": 0.1697,
      "mae_dtheta": 0.03591958433389664,
      "mae_dx": 0.011509237810969353,
      "mae_dy": 0.004741711542010307,
      "pose_mae_dtheta": 0.2915612459182739,
      "pose_mae_dx": 0.10388606041669846,
      "pose_mae_dy": 0.05981161445379257,
      "pose_rmse_dtheta": 0.5106022357940674,
      "pose_rmse_dx": 0.24019911885261536,
      "pose_rmse_dy": 0.12739971280097961,
      "pose_rmse_mean": 0.29273366928100586,
      "rmse_dtheta": 0.05467061698436737,
      "rmse_dx": 0.024318812415003777,
      "rmse_dy": 0.009776527062058449,
      "rmse_mean": 0.02958865277469158,
      "rotation_flip": 0.013752455823123455,
      "sparse_tokens": 25621.0,
      "step": 7421,
      "turn_loss": 0.27868783473968506,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3448243820851143,
      "grad_norm": 0.3976558446884155,
      "learning_rate": 3.2390591324226496e-06,
      "loss": 0.1335,
      "mae_dtheta": 0.008843958377838135,
      "mae_dx": 0.0024354946799576283,
      "mae_dy": 0.002129925647750497,
      "pose_mae_dtheta": 0.06188899651169777,
      "pose_mae_dx": 0.026230724528431892,
      "pose_mae_dy": 0.0256344024091959,
      "pose_rmse_dtheta": 0.15164262056350708,
      "pose_rmse_dx": 0.06991230696439743,
      "pose_rmse_dy": 0.06062101945281029,
      "pose_rmse_mean": 0.09405865520238876,
      "rmse_dtheta": 0.019863596186041832,
      "rmse_dx": 0.007821417413651943,
      "rmse_dy": 0.0048642223700881,
      "rmse_mean": 0.010849745944142342,
      "rotation_flip": 0.0019910403061658144,
      "sparse_tokens": 32057.0,
      "step": 7422,
      "turn_loss": 0.085169717669487,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.34487084185095707,
      "grad_norm": 0.6390365362167358,
      "learning_rate": 3.2378216904997345e-06,
      "loss": 0.0962,
      "mae_dtheta": 0.010080290026962757,
      "mae_dx": 0.00360691174864769,
      "mae_dy": 0.0013925776584073901,
      "pose_mae_dtheta": 0.0813935399055481,
      "pose_mae_dx": 0.035338837653398514,
      "pose_mae_dy": 0.020123722031712532,
      "pose_rmse_dtheta": 0.2251797765493393,
      "pose_rmse_dx": 0.11692206561565399,
      "pose_rmse_dy": 0.056739866733551025,
      "pose_rmse_mean": 0.13294723629951477,
      "rmse_dtheta": 0.02461489662528038,
      "rmse_dx": 0.011993657797574997,
      "rmse_dy": 0.004346239846199751,
      "rmse_mean": 0.013651598244905472,
      "rotation_flip": 0.005082591902464628,
      "sparse_tokens": 32089.0,
      "step": 7423,
      "turn_loss": 0.06987608969211578,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.34491730161679984,
      "grad_norm": 0.735339879989624,
      "learning_rate": 3.2365843718068944e-06,
      "loss": 0.0789,
      "mae_dtheta": 0.007081544492393732,
      "mae_dx": 0.001619671005755663,
      "mae_dy": 0.00024807185400277376,
      "pose_mae_dtheta": 0.05262226238846779,
      "pose_mae_dx": 0.012262132950127125,
      "pose_mae_dy": 0.0031108784023672342,
      "pose_rmse_dtheta": 0.2346116006374359,
      "pose_rmse_dx": 0.03008240833878517,
      "pose_rmse_dy": 0.007408223580569029,
      "pose_rmse_mean": 0.09070074558258057,
      "rmse_dtheta": 0.027459777891635895,
      "rmse_dx": 0.004343960899859667,
      "rmse_dy": 0.0005296774907037616,
      "rmse_mean": 0.010777805000543594,
      "rotation_flip": 0.0005370569415390491,
      "sparse_tokens": 32265.0,
      "step": 7424,
      "turn_loss": 0.04856650158762932,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26849.0,
      "epoch": 0.3449637613826426,
      "grad_norm": 0.5333160161972046,
      "learning_rate": 3.2353471764306567e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.028103630989789963,
      "mae_dx": 0.01000333670526743,
      "mae_dy": 0.0036510832142084837,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5333161950111389,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.1006622314453,
      "model/head/act_norm_mean": 117.60440982680723,
      "model/head/act_norm_min": 62.1817741394043,
      "model/head/act_over_embed": 80.81885146281374,
      "model/head/grad_frac": 0.1004815623164177,
      "model/head/grad_norm": 0.053588442504405975,
      "model/head/grad_zero_frac": 0.00019734303350560367,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6964420180722891,
      "model/head/update_ratio": 0.0009135506115853786,
      "model/head/weight_delta": 9.527441024780273,
      "model/head/weight_delta_rel": 0.16713953018188477,
      "model/head/weight_norm": 58.659523010253906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42205938696861267,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42205938696861267,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42205938696861267,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2900431621070665,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0598483644425869,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03191810101270676,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.00103090051561594,
      "model/modality_embedder.encoders.pose/weight_delta": 3.057973623275757,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09991353005170822,
      "model/modality_embedder.encoders.pose/weight_norm": 30.961380004882812,
      "model/modality_embedder/grad_frac": 0.0598483644425869,
      "model/modality_embedder/grad_norm": 0.03191810101270676,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.00103090051561594,
      "model/modality_embedder/weight_delta": 3.057973623275757,
      "model/modality_embedder/weight_delta_rel": 0.09991353005170822,
      "model/modality_embedder/weight_norm": 30.961380004882812,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.34554290771484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.282732118951998,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.236323356628418,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.68732085066369,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08526802808046341,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0454748198390007,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016291846986860037,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5215272903442383,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09188597649335861,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.91262435913086,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.69546508789062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.098719281889462,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.44863510131836,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.248074868426492,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07410743087530136,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0395226925611496,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013311043148860335,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.199214220046997,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11082328110933304,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.6916561126709,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.31100463867188,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.70243772709887,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.815211296081543,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.350165198223035,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07925178110599518,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04226625710725784,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013786471681669354,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.4550540447235107,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11601424217224121,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.657777786254883,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.89772033691406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.50262358959648,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.782478332519531,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.58726977653697,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08075801283121109,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04306955635547638,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014409086434170604,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.957402467727661,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10106997936964035,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.890552520751953,
      "model/normalizer/grad_frac": 0.35954105854034424,
      "model/normalizer/grad_norm": 0.19174906611442566,
      "model/normalizer/grad_zero_frac": 0.0001784424966899678,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002440511016175151,
      "model/normalizer/weight_delta": 6.2475128173828125,
      "model/normalizer/weight_delta_rel": 0.08046434819698334,
      "model/normalizer/weight_norm": 78.56922912597656,
      "pose_mae_dtheta": 0.23012369871139526,
      "pose_mae_dx": 0.08217831701040268,
      "pose_mae_dy": 0.05357174202799797,
      "pose_rmse_dtheta": 0.45609286427497864,
      "pose_rmse_dx": 0.2063184678554535,
      "pose_rmse_dy": 0.12828464806079865,
      "pose_rmse_mean": 0.263565331697464,
      "rmse_dtheta": 0.04632675275206566,
      "rmse_dx": 0.02304365485906601,
      "rmse_dy": 0.007305576466023922,
      "rmse_mean": 0.02555866166949272,
      "rotation_flip": 0.008687258698046207,
      "sparse_tokens": 20335.0,
      "step": 7425,
      "turn_loss": 0.17844142019748688,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3450102211484854,
      "grad_norm": 0.6045072674751282,
      "learning_rate": 3.234110104457536e-06,
      "loss": 0.1454,
      "mae_dtheta": 0.008692928589880466,
      "mae_dx": 0.0013904370134696364,
      "mae_dy": 0.0018001549178734422,
      "pose_mae_dtheta": 0.0546492375433445,
      "pose_mae_dx": 0.01733723282814026,
      "pose_mae_dy": 0.022877955809235573,
      "pose_rmse_dtheta": 0.12418125569820404,
      "pose_rmse_dx": 0.0423458032310009,
      "pose_rmse_dy": 0.053797122091054916,
      "pose_rmse_mean": 0.07344140112400055,
      "rmse_dtheta": 0.01818166673183441,
      "rmse_dx": 0.003895965637639165,
      "rmse_dy": 0.0036612229887396097,
      "rmse_mean": 0.008579619228839874,
      "rotation_flip": 0.010494752787053585,
      "sparse_tokens": 32153.0,
      "step": 7426,
      "turn_loss": 0.0725792795419693,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.3450566809143282,
      "grad_norm": 0.7064803242683411,
      "learning_rate": 3.232873155974046e-06,
      "loss": 0.202,
      "mae_dtheta": 0.046833500266075134,
      "mae_dx": 0.016069140285253525,
      "mae_dy": 0.006433655042201281,
      "pose_mae_dtheta": 0.37930259108543396,
      "pose_mae_dx": 0.11348319798707962,
      "pose_mae_dy": 0.07034320384263992,
      "pose_rmse_dtheta": 0.5755133032798767,
      "pose_rmse_dx": 0.24339133501052856,
      "pose_rmse_dy": 0.16270270943641663,
      "pose_rmse_mean": 0.3272024393081665,
      "rmse_dtheta": 0.0636402890086174,
      "rmse_dx": 0.028515877202153206,
      "rmse_dy": 0.013524926267564297,
      "rmse_mean": 0.035227030515670776,
      "rotation_flip": 0.025787966325879097,
      "sparse_tokens": 10499.0,
      "step": 7427,
      "turn_loss": 0.36650583148002625,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.34510314068017095,
      "grad_norm": 0.6746609807014465,
      "learning_rate": 3.231636331066683e-06,
      "loss": 0.1226,
      "mae_dtheta": 0.03224034979939461,
      "mae_dx": 0.00968899205327034,
      "mae_dy": 0.0033088994678109884,
      "pose_mae_dtheta": 0.260759562253952,
      "pose_mae_dx": 0.06888847798109055,
      "pose_mae_dy": 0.03376267850399017,
      "pose_rmse_dtheta": 0.4700946807861328,
      "pose_rmse_dx": 0.15648479759693146,
      "pose_rmse_dy": 0.07388034462928772,
      "pose_rmse_mean": 0.2334866225719452,
      "rmse_dtheta": 0.0530070997774601,
      "rmse_dx": 0.019485386088490486,
      "rmse_dy": 0.0065751029178500175,
      "rmse_mean": 0.026355862617492676,
      "rotation_flip": 0.011337868869304657,
      "sparse_tokens": 8467.0,
      "step": 7428,
      "turn_loss": 0.231599360704422,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.3451496004460137,
      "grad_norm": 1.0398375988006592,
      "learning_rate": 3.230399629821942e-06,
      "loss": 0.2584,
      "mae_dtheta": 0.02868761494755745,
      "mae_dx": 0.014331863261759281,
      "mae_dy": 0.0038777091540396214,
      "pose_mae_dtheta": 0.22681468725204468,
      "pose_mae_dx": 0.14677444100379944,
      "pose_mae_dy": 0.049927085638046265,
      "pose_rmse_dtheta": 0.3701636791229248,
      "pose_rmse_dx": 0.3044382929801941,
      "pose_rmse_dy": 0.11008772253990173,
      "pose_rmse_mean": 0.261563241481781,
      "rmse_dtheta": 0.04332192614674568,
      "rmse_dx": 0.02752472460269928,
      "rmse_dy": 0.006249383091926575,
      "rmse_mean": 0.025698676705360413,
      "rotation_flip": 0.016583748161792755,
      "sparse_tokens": 10418.0,
      "step": 7429,
      "turn_loss": 0.2356211245059967,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.34519606021185656,
      "grad_norm": 0.6443713307380676,
      "learning_rate": 3.229163052326303e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.045402757823467255,
      "mae_dx": 0.013071194291114807,
      "mae_dy": 0.005229571834206581,
      "pose_mae_dtheta": 0.3810744881629944,
      "pose_mae_dx": 0.12954649329185486,
      "pose_mae_dy": 0.05303691700100899,
      "pose_rmse_dtheta": 0.6493858098983765,
      "pose_rmse_dx": 0.2522643208503723,
      "pose_rmse_dy": 0.092784583568573,
      "pose_rmse_mean": 0.3314782381057739,
      "rmse_dtheta": 0.06723040342330933,
      "rmse_dx": 0.02588915079832077,
      "rmse_dy": 0.009706183336675167,
      "rmse_mean": 0.034275248646736145,
      "rotation_flip": 0.028490029275417328,
      "sparse_tokens": 5505.0,
      "step": 7430,
      "turn_loss": 0.3728136718273163,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.34524251997769934,
      "grad_norm": 0.4447597861289978,
      "learning_rate": 3.227926598666244e-06,
      "loss": 0.1006,
      "mae_dtheta": 0.04829283431172371,
      "mae_dx": 0.014083598740398884,
      "mae_dy": 0.006175619550049305,
      "pose_mae_dtheta": 0.40243297815322876,
      "pose_mae_dx": 0.11002211272716522,
      "pose_mae_dy": 0.07364028692245483,
      "pose_rmse_dtheta": 0.6292136311531067,
      "pose_rmse_dx": 0.22409243881702423,
      "pose_rmse_dy": 0.1511359065771103,
      "pose_rmse_mean": 0.33481401205062866,
      "rmse_dtheta": 0.06645318120718002,
      "rmse_dx": 0.025911832228302956,
      "rmse_dy": 0.012548555620014668,
      "rmse_mean": 0.034971192479133606,
      "rotation_flip": 0.018819503486156464,
      "sparse_tokens": 17980.0,
      "step": 7431,
      "turn_loss": 0.3395310938358307,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 32663.0,
      "epoch": 0.3452889797435421,
      "grad_norm": 1.040250301361084,
      "learning_rate": 3.2266902689282276e-06,
      "loss": 0.2858,
      "mae_dtheta": 0.028383569791913033,
      "mae_dx": 0.012716889381408691,
      "mae_dy": 0.0032759772147983313,
      "pose_mae_dtheta": 0.23050494492053986,
      "pose_mae_dx": 0.11225811392068863,
      "pose_mae_dy": 0.04816287383437157,
      "pose_rmse_dtheta": 0.4364525079727173,
      "pose_rmse_dx": 0.2729373872280121,
      "pose_rmse_dy": 0.1185692697763443,
      "pose_rmse_mean": 0.2759864032268524,
      "rmse_dtheta": 0.046292390674352646,
      "rmse_dx": 0.027107227593660355,
      "rmse_dy": 0.005838337354362011,
      "rmse_mean": 0.02641265094280243,
      "rotation_flip": 0.01133391447365284,
      "sparse_tokens": 24227.0,
      "step": 7432,
      "turn_loss": 0.20721420645713806,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.3453354395093849,
      "grad_norm": 0.7018298506736755,
      "learning_rate": 3.225454063198712e-06,
      "loss": 0.1288,
      "mae_dtheta": 0.029169052839279175,
      "mae_dx": 0.00955195352435112,
      "mae_dy": 0.004799466580152512,
      "pose_mae_dtheta": 0.22714678943157196,
      "pose_mae_dx": 0.07629609107971191,
      "pose_mae_dy": 0.04710274189710617,
      "pose_rmse_dtheta": 0.47281119227409363,
      "pose_rmse_dx": 0.1727680116891861,
      "pose_rmse_dy": 0.13157470524311066,
      "pose_rmse_mean": 0.2590513229370117,
      "rmse_dtheta": 0.04980270937085152,
      "rmse_dx": 0.020604770630598068,
      "rmse_dy": 0.010443533770740032,
      "rmse_mean": 0.02695033699274063,
      "rotation_flip": 0.030030030757188797,
      "sparse_tokens": 5891.0,
      "step": 7433,
      "turn_loss": 0.23645614087581635,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.34538189927522767,
      "grad_norm": 0.3934592008590698,
      "learning_rate": 3.2242179815641484e-06,
      "loss": 0.0831,
      "mae_dtheta": 0.022749440744519234,
      "mae_dx": 0.006159148644655943,
      "mae_dy": 0.002134635578840971,
      "pose_mae_dtheta": 0.16558247804641724,
      "pose_mae_dx": 0.04558999091386795,
      "pose_mae_dy": 0.028428558260202408,
      "pose_rmse_dtheta": 0.3776293694972992,
      "pose_rmse_dx": 0.12181674689054489,
      "pose_rmse_dy": 0.06707153469324112,
      "pose_rmse_mean": 0.18883922696113586,
      "rmse_dtheta": 0.04216504842042923,
      "rmse_dx": 0.01591568812727928,
      "rmse_dy": 0.003905768971890211,
      "rmse_mean": 0.02066216990351677,
      "rotation_flip": 0.01781737245619297,
      "sparse_tokens": 10254.0,
      "step": 7434,
      "turn_loss": 0.1317019909620285,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.34542835904107044,
      "grad_norm": 0.683718204498291,
      "learning_rate": 3.2229820241109722e-06,
      "loss": 0.126,
      "mae_dtheta": 0.03859839215874672,
      "mae_dx": 0.009655210189521313,
      "mae_dy": 0.003847189713269472,
      "pose_mae_dtheta": 0.28210562467575073,
      "pose_mae_dx": 0.0705580785870552,
      "pose_mae_dy": 0.03798701986670494,
      "pose_rmse_dtheta": 0.5277127623558044,
      "pose_rmse_dx": 0.1694537103176117,
      "pose_rmse_dy": 0.08887861669063568,
      "pose_rmse_mean": 0.26201504468917847,
      "rmse_dtheta": 0.05902835726737976,
      "rmse_dx": 0.020572446286678314,
      "rmse_dy": 0.008384858258068562,
      "rmse_mean": 0.02932855486869812,
      "rotation_flip": 0.01284403633326292,
      "sparse_tokens": 8942.0,
      "step": 7435,
      "turn_loss": 0.22862018644809723,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3454748188069132,
      "grad_norm": 0.5107062458992004,
      "learning_rate": 3.2217461909256186e-06,
      "loss": 0.098,
      "mae_dtheta": 0.00822379719465971,
      "mae_dx": 0.0015177330933511257,
      "mae_dy": 0.0012049543438479304,
      "pose_mae_dtheta": 0.055568378418684006,
      "pose_mae_dx": 0.014064023271203041,
      "pose_mae_dy": 0.01630226895213127,
      "pose_rmse_dtheta": 0.16307887434959412,
      "pose_rmse_dx": 0.032161861658096313,
      "pose_rmse_dy": 0.03923632204532623,
      "pose_rmse_mean": 0.07815901935100555,
      "rmse_dtheta": 0.022038720548152924,
      "rmse_dx": 0.004447657614946365,
      "rmse_dy": 0.0025672786869108677,
      "rmse_mean": 0.009684552438557148,
      "rotation_flip": 0.001254705130122602,
      "sparse_tokens": 32153.0,
      "step": 7436,
      "turn_loss": 0.06206345185637474,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.345521278572756,
      "grad_norm": 0.5421611070632935,
      "learning_rate": 3.2205104820945065e-06,
      "loss": 0.1071,
      "mae_dtheta": 0.027651885524392128,
      "mae_dx": 0.007130591664463282,
      "mae_dy": 0.004834216553717852,
      "pose_mae_dtheta": 0.2157331258058548,
      "pose_mae_dx": 0.05202828347682953,
      "pose_mae_dy": 0.04382980987429619,
      "pose_rmse_dtheta": 0.42737215757369995,
      "pose_rmse_dx": 0.11631480604410172,
      "pose_rmse_dy": 0.09323359280824661,
      "pose_rmse_mean": 0.21230685710906982,
      "rmse_dtheta": 0.04825005307793617,
      "rmse_dx": 0.01583179272711277,
      "rmse_dy": 0.010446151718497276,
      "rmse_mean": 0.02484266832470894,
      "rotation_flip": 0.006741573102772236,
      "sparse_tokens": 6925.0,
      "step": 7437,
      "turn_loss": 0.3058614730834961,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 15917.0,
      "epoch": 0.3455677383385988,
      "grad_norm": 0.5325682759284973,
      "learning_rate": 3.2192748977040535e-06,
      "loss": 0.1226,
      "mae_dtheta": 0.03349364921450615,
      "mae_dx": 0.010719602927565575,
      "mae_dy": 0.005200767423957586,
      "pose_mae_dtheta": 0.2243046760559082,
      "pose_mae_dx": 0.08511628210544586,
      "pose_mae_dy": 0.06081748753786087,
      "pose_rmse_dtheta": 0.380552738904953,
      "pose_rmse_dx": 0.19678141176700592,
      "pose_rmse_dy": 0.1485564112663269,
      "pose_rmse_mean": 0.24196353554725647,
      "rmse_dtheta": 0.05011191964149475,
      "rmse_dx": 0.022501256316900253,
      "rmse_dy": 0.010823460295796394,
      "rmse_mean": 0.027812212705612183,
      "rotation_flip": 0.01184210553765297,
      "sparse_tokens": 12936.0,
      "step": 7438,
      "turn_loss": 0.24258337914943695,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.34561419810444155,
      "grad_norm": 0.5944303274154663,
      "learning_rate": 3.218039437840661e-06,
      "loss": 0.092,
      "mae_dtheta": 0.009224042296409607,
      "mae_dx": 0.0013562337262555957,
      "mae_dy": 0.0009755113278515637,
      "pose_mae_dtheta": 0.06830506026744843,
      "pose_mae_dx": 0.014226874336600304,
      "pose_mae_dy": 0.014156054705381393,
      "pose_rmse_dtheta": 0.24978899955749512,
      "pose_rmse_dx": 0.03926572948694229,
      "pose_rmse_dy": 0.04793138802051544,
      "pose_rmse_mean": 0.11232870817184448,
      "rmse_dtheta": 0.02713993936777115,
      "rmse_dx": 0.004465871024876833,
      "rmse_dy": 0.0029299180023372173,
      "rmse_mean": 0.011511909775435925,
      "rotation_flip": 0.0015376729425042868,
      "sparse_tokens": 32153.0,
      "step": 7439,
      "turn_loss": 0.05575167015194893,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.3456606578702843,
      "grad_norm": 0.5609675049781799,
      "learning_rate": 3.216804102590728e-06,
      "loss": 0.1548,
      "mae_dtheta": 0.033858343958854675,
      "mae_dx": 0.00891855824738741,
      "mae_dy": 0.005411623977124691,
      "pose_mae_dtheta": 0.25752538442611694,
      "pose_mae_dx": 0.0699872076511383,
      "pose_mae_dy": 0.06000461056828499,
      "pose_rmse_dtheta": 0.4832380712032318,
      "pose_rmse_dx": 0.17505845427513123,
      "pose_rmse_dy": 0.1663687378168106,
      "pose_rmse_mean": 0.27488842606544495,
      "rmse_dtheta": 0.053925223648548126,
      "rmse_dx": 0.02050027996301651,
      "rmse_dy": 0.013657043687999249,
      "rmse_mean": 0.029360849410295486,
      "rotation_flip": 0.006125574465841055,
      "sparse_tokens": 21174.0,
      "step": 7440,
      "turn_loss": 0.29159796237945557,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.3457071176361271,
      "grad_norm": 0.6446421146392822,
      "learning_rate": 3.2155688920406415e-06,
      "loss": 0.1522,
      "mae_dtheta": 0.018846901133656502,
      "mae_dx": 0.008927727118134499,
      "mae_dy": 0.004094074480235577,
      "pose_mae_dtheta": 0.13889659941196442,
      "pose_mae_dx": 0.072259820997715,
      "pose_mae_dy": 0.04302618280053139,
      "pose_rmse_dtheta": 0.22438408434391022,
      "pose_rmse_dx": 0.17345798015594482,
      "pose_rmse_dy": 0.08725199103355408,
      "pose_rmse_mean": 0.16169801354408264,
      "rmse_dtheta": 0.03038661740720272,
      "rmse_dx": 0.019879557192325592,
      "rmse_dy": 0.007544696796685457,
      "rmse_mean": 0.019270291551947594,
      "rotation_flip": 0.0074349441565573215,
      "sparse_tokens": 10055.0,
      "step": 7441,
      "turn_loss": 0.1962079405784607,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3457535774019699,
      "grad_norm": 0.49502691626548767,
      "learning_rate": 3.2143338062767798e-06,
      "loss": 0.0689,
      "mae_dtheta": 0.008044703863561153,
      "mae_dx": 0.0013729307102039456,
      "mae_dy": 0.0015708537539467216,
      "pose_mae_dtheta": 0.052633631974458694,
      "pose_mae_dx": 0.014098945073783398,
      "pose_mae_dy": 0.017511991783976555,
      "pose_rmse_dtheta": 0.15440286695957184,
      "pose_rmse_dx": 0.04090054705739021,
      "pose_rmse_dy": 0.05028706043958664,
      "pose_rmse_mean": 0.08186349272727966,
      "rmse_dtheta": 0.021707193925976753,
      "rmse_dx": 0.004252754617482424,
      "rmse_dy": 0.0044767847284674644,
      "rmse_mean": 0.010145577602088451,
      "rotation_flip": 0.006863780319690704,
      "sparse_tokens": 32089.0,
      "step": 7442,
      "turn_loss": 0.07135675847530365,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.34580003716781266,
      "grad_norm": 0.5440035462379456,
      "learning_rate": 3.2130988453855132e-06,
      "loss": 0.104,
      "mae_dtheta": 0.011164478026330471,
      "mae_dx": 0.0017079183598980308,
      "mae_dy": 0.002939345547929406,
      "pose_mae_dtheta": 0.07176373153924942,
      "pose_mae_dx": 0.020789727568626404,
      "pose_mae_dy": 0.03180702030658722,
      "pose_rmse_dtheta": 0.1448649913072586,
      "pose_rmse_dx": 0.04314146563410759,
      "pose_rmse_dy": 0.06304226815700531,
      "pose_rmse_mean": 0.08368291705846786,
      "rmse_dtheta": 0.02136567421257496,
      "rmse_dx": 0.004644035827368498,
      "rmse_dy": 0.006153378169983625,
      "rmse_mean": 0.010721029713749886,
      "rotation_flip": 0.005899704992771149,
      "sparse_tokens": 32105.0,
      "step": 7443,
      "turn_loss": 0.0817149356007576,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.34584649693365543,
      "grad_norm": 0.5298169851303101,
      "learning_rate": 3.211864009453204e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.0066430838778615,
      "mae_dx": 0.001417702529579401,
      "mae_dy": 0.0010708760237321258,
      "pose_mae_dtheta": 0.04654049128293991,
      "pose_mae_dx": 0.01473418902605772,
      "pose_mae_dy": 0.013856672681868076,
      "pose_rmse_dtheta": 0.1654265969991684,
      "pose_rmse_dx": 0.04135793447494507,
      "pose_rmse_dy": 0.03745490685105324,
      "pose_rmse_mean": 0.0814131498336792,
      "rmse_dtheta": 0.020930932834744453,
      "rmse_dx": 0.004924150183796883,
      "rmse_dy": 0.002717746887356043,
      "rmse_mean": 0.009524276480078697,
      "rotation_flip": 0.003306878264993429,
      "sparse_tokens": 32073.0,
      "step": 7444,
      "turn_loss": 0.04715143144130707,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3458929566994982,
      "grad_norm": 0.3799820840358734,
      "learning_rate": 3.210629298566203e-06,
      "loss": 0.0783,
      "mae_dtheta": 0.008104481734335423,
      "mae_dx": 0.001098000444471836,
      "mae_dy": 0.0018329855520278215,
      "pose_mae_dtheta": 0.04872491583228111,
      "pose_mae_dx": 0.016430847346782684,
      "pose_mae_dy": 0.022738877683877945,
      "pose_rmse_dtheta": 0.11246832460165024,
      "pose_rmse_dx": 0.039092518389225006,
      "pose_rmse_dy": 0.05145630985498428,
      "pose_rmse_mean": 0.06767238676548004,
      "rmse_dtheta": 0.018444804474711418,
      "rmse_dx": 0.0032784384675323963,
      "rmse_dy": 0.0035635139793157578,
      "rmse_mean": 0.00842891912907362,
      "rotation_flip": 0.0019786308985203505,
      "sparse_tokens": 32057.0,
      "step": 7445,
      "turn_loss": 0.07374807447195053,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.345939416465341,
      "grad_norm": 0.5530640482902527,
      "learning_rate": 3.209394712810857e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.030745308846235275,
      "mae_dx": 0.011423449963331223,
      "mae_dy": 0.0038491487503051758,
      "pose_mae_dtheta": 0.23346252739429474,
      "pose_mae_dx": 0.09320156276226044,
      "pose_mae_dy": 0.0492980033159256,
      "pose_rmse_dtheta": 0.424886018037796,
      "pose_rmse_dx": 0.20968207716941833,
      "pose_rmse_dy": 0.11268815398216248,
      "pose_rmse_mean": 0.2490854263305664,
      "rmse_dtheta": 0.049657419323921204,
      "rmse_dx": 0.023899663239717484,
      "rmse_dy": 0.0077478159219026566,
      "rmse_mean": 0.027101632207632065,
      "rotation_flip": 0.015834348276257515,
      "sparse_tokens": 15585.0,
      "step": 7446,
      "turn_loss": 0.23434294760227203,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3459858762311838,
      "grad_norm": 0.5422241687774658,
      "learning_rate": 3.2081602522734987e-06,
      "loss": 0.1221,
      "mae_dtheta": 0.0052627017721533775,
      "mae_dx": 0.0011868180008605123,
      "mae_dy": 0.0010055251186713576,
      "pose_mae_dtheta": 0.03533967211842537,
      "pose_mae_dx": 0.012349325232207775,
      "pose_mae_dy": 0.015805883333086967,
      "pose_rmse_dtheta": 0.08663059026002884,
      "pose_rmse_dx": 0.035425521433353424,
      "pose_rmse_dy": 0.05820517614483833,
      "pose_rmse_mean": 0.06008709594607353,
      "rmse_dtheta": 0.013806442730128765,
      "rmse_dx": 0.003938750829547644,
      "rmse_dy": 0.0028149213176220655,
      "rmse_mean": 0.0068533713929355145,
      "rotation_flip": 0.0012787723680958152,
      "sparse_tokens": 32089.0,
      "step": 7447,
      "turn_loss": 0.0459098294377327,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3460323359970266,
      "grad_norm": 0.695294976234436,
      "learning_rate": 3.2069259170404577e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.010597032494843006,
      "mae_dx": 0.0016455972800031304,
      "mae_dy": 0.002921030391007662,
      "pose_mae_dtheta": 0.07187239080667496,
      "pose_mae_dx": 0.02325308322906494,
      "pose_mae_dy": 0.03136945515871048,
      "pose_rmse_dtheta": 0.2116125077009201,
      "pose_rmse_dx": 0.07564641535282135,
      "pose_rmse_dy": 0.08564653247594833,
      "pose_rmse_mean": 0.12430182099342346,
      "rmse_dtheta": 0.02339552342891693,
      "rmse_dx": 0.00469155702739954,
      "rmse_dy": 0.007201371714472771,
      "rmse_mean": 0.011762818321585655,
      "rotation_flip": 0.0026158445980399847,
      "sparse_tokens": 32057.0,
      "step": 7448,
      "turn_loss": 0.09204065054655075,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.3460787957628694,
      "grad_norm": 0.8465318083763123,
      "learning_rate": 3.2056917071980475e-06,
      "loss": 0.158,
      "mae_dtheta": 0.02654859609901905,
      "mae_dx": 0.008826945908367634,
      "mae_dy": 0.0031536458991467953,
      "pose_mae_dtheta": 0.21786493062973022,
      "pose_mae_dx": 0.06040230765938759,
      "pose_mae_dy": 0.0476883128285408,
      "pose_rmse_dtheta": 0.44366586208343506,
      "pose_rmse_dx": 0.16150754690170288,
      "pose_rmse_dy": 0.15243571996688843,
      "pose_rmse_mean": 0.2525363862514496,
      "rmse_dtheta": 0.04689705744385719,
      "rmse_dx": 0.02032650075852871,
      "rmse_dy": 0.008780746720731258,
      "rmse_mean": 0.025334767997264862,
      "rotation_flip": 0.017543859779834747,
      "sparse_tokens": 10405.0,
      "step": 7449,
      "turn_loss": 0.17591741681098938,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.34612525552871215,
      "grad_norm": 0.40912094712257385,
      "learning_rate": 3.2044576228325807e-06,
      "loss": 0.0738,
      "mae_dtheta": 0.030424639582633972,
      "mae_dx": 0.01290093269199133,
      "mae_dy": 0.008638015948235989,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.40912094712257385,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 132.10263061523438,
      "model/head/act_norm_mean": 102.606689453125,
      "model/head/act_norm_min": 83.21844482421875,
      "model/head/act_over_embed": 70.51227761114896,
      "model/head/grad_frac": 0.10329516977071762,
      "model/head/grad_norm": 0.042260218411684036,
      "model/head/grad_zero_frac": 0.00018338309018872678,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7032335069444444,
      "model/head/update_ratio": 0.0007204173598438501,
      "model/head/weight_delta": 9.534656524658203,
      "model/head/weight_delta_rel": 0.1672661155462265,
      "model/head/weight_norm": 58.660743713378906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42203980684280396,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4220042479665656,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42197534441947937,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29000527006864024,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11371887475252151,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0465247742831707,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5386513157894737,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015026606852188706,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0584065914154053,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09992767870426178,
      "model/modality_embedder.encoders.pose/weight_norm": 30.961597442626953,
      "model/modality_embedder/grad_frac": 0.11371887475252151,
      "model/modality_embedder/grad_norm": 0.0465247742831707,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5386513157894737,
      "model/modality_embedder/update_ratio": 0.0015026606852188706,
      "model/modality_embedder/weight_delta": 3.0584065914154053,
      "model/modality_embedder/weight_delta_rel": 0.09992767870426178,
      "model/modality_embedder/weight_norm": 30.961597442626953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 64.09732818603516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.86121272872575,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.283899307250977,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.710439417226,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11126068979501724,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04551908001303673,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016307472251355648,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.524674415588379,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09200065582990646,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.91301918029785,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 65.1805648803711,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.625177400242503,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.842862129211426,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.235443091842253,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09497251361608505,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03885524347424507,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013085788814350963,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.20343279838562,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1109694167971611,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.692703247070312,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 66.4120864868164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.22118710041887,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.699284553527832,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.332235899881685,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09605513513088226,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0392981693148613,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00128178542945534,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.460007667541504,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11618057638406754,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.6589298248291,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 66.86369323730469,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.18823371362434,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.761305809020996,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.68400874825702,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11321869492530823,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04632014036178589,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015496121486648917,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.9612653255462646,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10120199620723724,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.891441345214844,
      "model/normalizer/grad_frac": 0.4507019817829132,
      "model/normalizer/grad_norm": 0.18439161777496338,
      "model/normalizer/grad_zero_frac": 0.0001772607647581026,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0023468344006687403,
      "model/normalizer/weight_delta": 6.255893707275391,
      "model/normalizer/weight_delta_rel": 0.08057229220867157,
      "model/normalizer/weight_norm": 78.57035827636719,
      "pose_mae_dtheta": 0.220320925116539,
      "pose_mae_dx": 0.07249810546636581,
      "pose_mae_dy": 0.10965067893266678,
      "pose_rmse_dtheta": 0.34698814153671265,
      "pose_rmse_dx": 0.1489475667476654,
      "pose_rmse_dy": 0.21144632995128632,
      "pose_rmse_mean": 0.23579400777816772,
      "rmse_dtheta": 0.042811013758182526,
      "rmse_dx": 0.025209367275238037,
      "rmse_dy": 0.012747479602694511,
      "rmse_mean": 0.026922620832920074,
      "rotation_flip": 0.011952191591262817,
      "sparse_tokens": 5144.0,
      "step": 7450,
      "turn_loss": 0.2841498553752899,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3461717152945549,
      "grad_norm": 0.6395520567893982,
      "learning_rate": 3.203223664030355e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.010260040871798992,
      "mae_dx": 0.0014842711389064789,
      "mae_dy": 0.002630640519782901,
      "pose_mae_dtheta": 0.06480370461940765,
      "pose_mae_dx": 0.02769351378083229,
      "pose_mae_dy": 0.034646764397621155,
      "pose_rmse_dtheta": 0.12462545931339264,
      "pose_rmse_dx": 0.06633614748716354,
      "pose_rmse_dy": 0.07734058052301407,
      "pose_rmse_mean": 0.08943405747413635,
      "rmse_dtheta": 0.01901290751993656,
      "rmse_dx": 0.003991677425801754,
      "rmse_dy": 0.005165755748748779,
      "rmse_mean": 0.00939011387526989,
      "rotation_flip": 0.004879748914390802,
      "sparse_tokens": 32105.0,
      "step": 7451,
      "turn_loss": 0.08826904743909836,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3462181750603977,
      "grad_norm": 0.671289324760437,
      "learning_rate": 3.201989830877662e-06,
      "loss": 0.1319,
      "mae_dtheta": 0.008482975885272026,
      "mae_dx": 0.0014376024482771754,
      "mae_dy": 0.0005414250772446394,
      "pose_mae_dtheta": 0.06482560932636261,
      "pose_mae_dx": 0.011872841976583004,
      "pose_mae_dy": 0.007203662768006325,
      "pose_rmse_dtheta": 0.26829949021339417,
      "pose_rmse_dx": 0.026527339592576027,
      "pose_rmse_dy": 0.020520076155662537,
      "pose_rmse_mean": 0.10511563718318939,
      "rmse_dtheta": 0.02976963296532631,
      "rmse_dx": 0.003906643018126488,
      "rmse_dy": 0.0015539700398221612,
      "rmse_mean": 0.011743415147066116,
      "rotation_flip": 0.0036166366189718246,
      "sparse_tokens": 32201.0,
      "step": 7452,
      "turn_loss": 0.04930734261870384,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23368.0,
      "epoch": 0.3462646348262405,
      "grad_norm": 0.5870874524116516,
      "learning_rate": 3.200756123460788e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.03207405284047127,
      "mae_dx": 0.00943031720817089,
      "mae_dy": 0.004497321788221598,
      "pose_mae_dtheta": 0.2547255754470825,
      "pose_mae_dx": 0.07678612321615219,
      "pose_mae_dy": 0.056388866156339645,
      "pose_rmse_dtheta": 0.49024614691734314,
      "pose_rmse_dx": 0.17908413708209991,
      "pose_rmse_dy": 0.1713925153017044,
      "pose_rmse_mean": 0.2802409529685974,
      "rmse_dtheta": 0.05285848304629326,
      "rmse_dx": 0.02077043615281582,
      "rmse_dy": 0.010656041093170643,
      "rmse_mean": 0.02809498831629753,
      "rotation_flip": 0.01005025114864111,
      "sparse_tokens": 19365.0,
      "step": 7453,
      "turn_loss": 0.22552980482578278,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.34631109459208326,
      "grad_norm": 0.49924108386039734,
      "learning_rate": 3.1995225418660014e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.010139092803001404,
      "mae_dx": 0.0011949563631787896,
      "mae_dy": 0.0019755058456212282,
      "pose_mae_dtheta": 0.06245161220431328,
      "pose_mae_dx": 0.01756754145026207,
      "pose_mae_dy": 0.024526657536625862,
      "pose_rmse_dtheta": 0.15003977715969086,
      "pose_rmse_dx": 0.042228031903505325,
      "pose_rmse_dy": 0.05504241958260536,
      "pose_rmse_mean": 0.08243674039840698,
      "rmse_dtheta": 0.021722281351685524,
      "rmse_dx": 0.0038634389638900757,
      "rmse_dy": 0.004367698449641466,
      "rmse_mean": 0.009984472766518593,
      "rotation_flip": 0.00222634500823915,
      "sparse_tokens": 32105.0,
      "step": 7454,
      "turn_loss": 0.08353395015001297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.34635755435792603,
      "grad_norm": 0.543854832649231,
      "learning_rate": 3.198289086179572e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.03779648244380951,
      "mae_dx": 0.008411365561187267,
      "mae_dy": 0.008453602902591228,
      "pose_mae_dtheta": 0.28246551752090454,
      "pose_mae_dx": 0.0624842643737793,
      "pose_mae_dy": 0.11302182823419571,
      "pose_rmse_dtheta": 0.49701252579689026,
      "pose_rmse_dx": 0.11849954724311829,
      "pose_rmse_dy": 0.21614636480808258,
      "pose_rmse_mean": 0.2772194743156433,
      "rmse_dtheta": 0.05442773178219795,
      "rmse_dx": 0.01734795980155468,
      "rmse_dy": 0.013648360036313534,
      "rmse_mean": 0.028474684804677963,
      "rotation_flip": 0.0062500000931322575,
      "sparse_tokens": 11056.0,
      "step": 7455,
      "turn_loss": 0.2950151860713959,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.3464040141237688,
      "grad_norm": 0.8674201965332031,
      "learning_rate": 3.1970557564877524e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.0423675961792469,
      "mae_dx": 0.017917748540639877,
      "mae_dy": 0.00809143390506506,
      "pose_mae_dtheta": 0.38413476943969727,
      "pose_mae_dx": 0.13313992321491241,
      "pose_mae_dy": 0.09993898123502731,
      "pose_rmse_dtheta": 0.6009612679481506,
      "pose_rmse_dx": 0.28361770510673523,
      "pose_rmse_dy": 0.21722455322742462,
      "pose_rmse_mean": 0.3672678470611572,
      "rmse_dtheta": 0.06148869916796684,
      "rmse_dx": 0.0315374992787838,
      "rmse_dy": 0.014424127526581287,
      "rmse_mean": 0.035816777497529984,
      "rotation_flip": 0.00561797758564353,
      "sparse_tokens": 3095.0,
      "step": 7456,
      "turn_loss": 0.2844427227973938,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.3464504738896116,
      "grad_norm": 0.4056919515132904,
      "learning_rate": 3.1958225528767918e-06,
      "loss": 0.0834,
      "mae_dtheta": 0.031230732798576355,
      "mae_dx": 0.014028164558112621,
      "mae_dy": 0.00732889398932457,
      "pose_mae_dtheta": 0.2661629915237427,
      "pose_mae_dx": 0.12048854678869247,
      "pose_mae_dy": 0.10178646445274353,
      "pose_rmse_dtheta": 0.41163936257362366,
      "pose_rmse_dx": 0.22897674143314362,
      "pose_rmse_dy": 0.2255880981683731,
      "pose_rmse_mean": 0.2887347340583801,
      "rmse_dtheta": 0.045382365584373474,
      "rmse_dx": 0.026625562459230423,
      "rmse_dy": 0.012955945916473866,
      "rmse_mean": 0.028321292251348495,
      "rotation_flip": 0.010146561078727245,
      "sparse_tokens": 18943.0,
      "step": 7457,
      "turn_loss": 0.3294171988964081,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.34649693365545436,
      "grad_norm": 0.661307156085968,
      "learning_rate": 3.1945894754329286e-06,
      "loss": 0.1141,
      "mae_dtheta": 0.028922028839588165,
      "mae_dx": 0.00642768619582057,
      "mae_dy": 0.0067791384644806385,
      "pose_mae_dtheta": 0.22831828892230988,
      "pose_mae_dx": 0.06886664032936096,
      "pose_mae_dy": 0.07895029336214066,
      "pose_rmse_dtheta": 0.4574657380580902,
      "pose_rmse_dx": 0.19039899110794067,
      "pose_rmse_dy": 0.19903749227523804,
      "pose_rmse_mean": 0.282300740480423,
      "rmse_dtheta": 0.047720134258270264,
      "rmse_dx": 0.017139706760644913,
      "rmse_dy": 0.014921329915523529,
      "rmse_mean": 0.02659372240304947,
      "rotation_flip": 0.01515151560306549,
      "sparse_tokens": 7830.0,
      "step": 7458,
      "turn_loss": 0.24937322735786438,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.34654339342129714,
      "grad_norm": 0.5041424036026001,
      "learning_rate": 3.1933565242423925e-06,
      "loss": 0.083,
      "mae_dtheta": 0.02348850667476654,
      "mae_dx": 0.004147323314100504,
      "mae_dy": 0.002755971159785986,
      "pose_mae_dtheta": 0.1840812861919403,
      "pose_mae_dx": 0.040636613965034485,
      "pose_mae_dy": 0.04913092777132988,
      "pose_rmse_dtheta": 0.41403481364250183,
      "pose_rmse_dx": 0.09613468497991562,
      "pose_rmse_dy": 0.14611466228961945,
      "pose_rmse_mean": 0.2187613844871521,
      "rmse_dtheta": 0.043960411101579666,
      "rmse_dx": 0.01193743385374546,
      "rmse_dy": 0.005839504301548004,
      "rmse_mean": 0.02057911828160286,
      "rotation_flip": 0.003846153849735856,
      "sparse_tokens": 15246.0,
      "step": 7459,
      "turn_loss": 0.1756446212530136,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3465898531871399,
      "grad_norm": 0.39383888244628906,
      "learning_rate": 3.192123699391404e-06,
      "loss": 0.0762,
      "mae_dtheta": 0.009314361959695816,
      "mae_dx": 0.0014729590620845556,
      "mae_dy": 0.0024206223897635937,
      "pose_mae_dtheta": 0.0685553103685379,
      "pose_mae_dx": 0.017461614683270454,
      "pose_mae_dy": 0.022271672263741493,
      "pose_rmse_dtheta": 0.19938765466213226,
      "pose_rmse_dx": 0.04932377487421036,
      "pose_rmse_dy": 0.05687104910612106,
      "pose_rmse_mean": 0.10186083614826202,
      "rmse_dtheta": 0.022785264998674393,
      "rmse_dx": 0.003660670481622219,
      "rmse_dy": 0.005177739076316357,
      "rmse_mean": 0.010541225783526897,
      "rotation_flip": 0.001721170381642878,
      "sparse_tokens": 32089.0,
      "step": 7460,
      "turn_loss": 0.07016447931528091,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3466363129529827,
      "grad_norm": 0.44560506939888,
      "learning_rate": 3.190891000966176e-06,
      "loss": 0.1061,
      "mae_dtheta": 0.009461543522775173,
      "mae_dx": 0.0014982197899371386,
      "mae_dy": 0.002120519755408168,
      "pose_mae_dtheta": 0.06270790100097656,
      "pose_mae_dx": 0.01748037524521351,
      "pose_mae_dy": 0.022458167746663094,
      "pose_rmse_dtheta": 0.17108896374702454,
      "pose_rmse_dx": 0.03738784044981003,
      "pose_rmse_dy": 0.050763946026563644,
      "pose_rmse_mean": 0.08641358464956284,
      "rmse_dtheta": 0.021457621827721596,
      "rmse_dx": 0.004136991687119007,
      "rmse_dy": 0.004837809596210718,
      "rmse_mean": 0.010144141502678394,
      "rotation_flip": 0.005263158120214939,
      "sparse_tokens": 32137.0,
      "step": 7461,
      "turn_loss": 0.08610492944717407,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.34668277271882547,
      "grad_norm": 0.6522879004478455,
      "learning_rate": 3.1896584290529108e-06,
      "loss": 0.1674,
      "mae_dtheta": 0.012565221637487411,
      "mae_dx": 0.001695784623734653,
      "mae_dy": 0.0028387662023305893,
      "pose_mae_dtheta": 0.08473196625709534,
      "pose_mae_dx": 0.02289527840912342,
      "pose_mae_dy": 0.032226309180259705,
      "pose_rmse_dtheta": 0.20618583261966705,
      "pose_rmse_dx": 0.06175344064831734,
      "pose_rmse_dy": 0.07163722813129425,
      "pose_rmse_mean": 0.11319216340780258,
      "rmse_dtheta": 0.025631627067923546,
      "rmse_dx": 0.004778179340064526,
      "rmse_dy": 0.006011530756950378,
      "rmse_mean": 0.012140445411205292,
      "rotation_flip": 0.0042432816699147224,
      "sparse_tokens": 32105.0,
      "step": 7462,
      "turn_loss": 0.11242255568504333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22649.0,
      "epoch": 0.3467292324846683,
      "grad_norm": 0.4773904085159302,
      "learning_rate": 3.188425983737804e-06,
      "loss": 0.0767,
      "mae_dtheta": 0.023897796869277954,
      "mae_dx": 0.010753411799669266,
      "mae_dy": 0.003990404307842255,
      "pose_mae_dtheta": 0.19772829115390778,
      "pose_mae_dx": 0.09177190065383911,
      "pose_mae_dy": 0.055053967982530594,
      "pose_rmse_dtheta": 0.3412275016307831,
      "pose_rmse_dx": 0.24553664028644562,
      "pose_rmse_dy": 0.11589890718460083,
      "pose_rmse_mean": 0.23422102630138397,
      "rmse_dtheta": 0.03857383877038956,
      "rmse_dx": 0.02448887750506401,
      "rmse_dy": 0.00855373963713646,
      "rmse_mean": 0.023872151970863342,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 17686.0,
      "step": 7463,
      "turn_loss": 0.22142601013183594,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3467756922505111,
      "grad_norm": 0.3646274209022522,
      "learning_rate": 3.187193665107039e-06,
      "loss": 0.0724,
      "mae_dtheta": 0.00653051258996129,
      "mae_dx": 0.0013796964194625616,
      "mae_dy": 0.0007256246753968298,
      "pose_mae_dtheta": 0.05049291253089905,
      "pose_mae_dx": 0.012614413164556026,
      "pose_mae_dy": 0.011171977035701275,
      "pose_rmse_dtheta": 0.1722455769777298,
      "pose_rmse_dx": 0.029378877952694893,
      "pose_rmse_dy": 0.029851630330085754,
      "pose_rmse_mean": 0.07715869694948196,
      "rmse_dtheta": 0.02133333683013916,
      "rmse_dx": 0.003962122369557619,
      "rmse_dy": 0.0017273279372602701,
      "rmse_mean": 0.009007595479488373,
      "rotation_flip": 0.0018433179939165711,
      "sparse_tokens": 32201.0,
      "step": 7464,
      "turn_loss": 0.04682150110602379,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.34682215201635386,
      "grad_norm": 0.4964657723903656,
      "learning_rate": 3.1859614732467957e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.008112441748380661,
      "mae_dx": 0.0009842466097325087,
      "mae_dy": 0.0017666827188804746,
      "pose_mae_dtheta": 0.05183546617627144,
      "pose_mae_dx": 0.011691476218402386,
      "pose_mae_dy": 0.02265053801238537,
      "pose_rmse_dtheta": 0.14145047962665558,
      "pose_rmse_dx": 0.030559565871953964,
      "pose_rmse_dy": 0.051645856350660324,
      "pose_rmse_mean": 0.07455196976661682,
      "rmse_dtheta": 0.019041307270526886,
      "rmse_dx": 0.0033265489619225264,
      "rmse_dy": 0.004771609790623188,
      "rmse_mean": 0.009046489372849464,
      "rotation_flip": 0.007287871092557907,
      "sparse_tokens": 32073.0,
      "step": 7465,
      "turn_loss": 0.0612979456782341,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.34686861178219663,
      "grad_norm": 0.501928985118866,
      "learning_rate": 3.1847294082432388e-06,
      "loss": 0.1066,
      "mae_dtheta": 0.00945826806128025,
      "mae_dx": 0.00149312533903867,
      "mae_dy": 0.0019542372319847345,
      "pose_mae_dtheta": 0.05990421026945114,
      "pose_mae_dx": 0.019079256802797318,
      "pose_mae_dy": 0.020641818642616272,
      "pose_rmse_dtheta": 0.15791383385658264,
      "pose_rmse_dx": 0.04567636176943779,
      "pose_rmse_dy": 0.05120772495865822,
      "pose_rmse_mean": 0.08493264764547348,
      "rmse_dtheta": 0.021458836272358894,
      "rmse_dx": 0.004636205267161131,
      "rmse_dy": 0.004411349538713694,
      "rmse_mean": 0.010168797336518764,
      "rotation_flip": 0.0011227545328438282,
      "sparse_tokens": 32121.0,
      "step": 7466,
      "turn_loss": 0.07348795980215073,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17859.0,
      "epoch": 0.3469150715480394,
      "grad_norm": 0.5847969651222229,
      "learning_rate": 3.1834974701825305e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.02236497960984707,
      "mae_dx": 0.010277637280523777,
      "mae_dy": 0.0023958636447787285,
      "pose_mae_dtheta": 0.16201254725456238,
      "pose_mae_dx": 0.07492624968290329,
      "pose_mae_dy": 0.03345843777060509,
      "pose_rmse_dtheta": 0.3525673449039459,
      "pose_rmse_dx": 0.19319093227386475,
      "pose_rmse_dy": 0.08194872736930847,
      "pose_rmse_mean": 0.20923566818237305,
      "rmse_dtheta": 0.04044952243566513,
      "rmse_dx": 0.02355874516069889,
      "rmse_dy": 0.004823835100978613,
      "rmse_mean": 0.02294403314590454,
      "rotation_flip": 0.007552870083600283,
      "sparse_tokens": 12970.0,
      "step": 7467,
      "turn_loss": 0.1502382904291153,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3469615313138822,
      "grad_norm": 0.4416273236274719,
      "learning_rate": 3.1822656591508172e-06,
      "loss": 0.0707,
      "mae_dtheta": 0.011744261719286442,
      "mae_dx": 0.0031817760318517685,
      "mae_dy": 0.0027247010730206966,
      "pose_mae_dtheta": 0.08194449543952942,
      "pose_mae_dx": 0.0367048904299736,
      "pose_mae_dy": 0.03293347358703613,
      "pose_rmse_dtheta": 0.20498086512088776,
      "pose_rmse_dx": 0.09453429281711578,
      "pose_rmse_dy": 0.08150985836982727,
      "pose_rmse_mean": 0.1270083487033844,
      "rmse_dtheta": 0.026312755420804024,
      "rmse_dx": 0.008656260557472706,
      "rmse_dy": 0.006409468594938517,
      "rmse_mean": 0.01379282958805561,
      "rotation_flip": 0.005767524242401123,
      "sparse_tokens": 32089.0,
      "step": 7468,
      "turn_loss": 0.12413900345563889,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.34700799107972496,
      "grad_norm": 0.3052107095718384,
      "learning_rate": 3.1810339752342446e-06,
      "loss": 0.081,
      "mae_dtheta": 0.008202394470572472,
      "mae_dx": 0.001881150878034532,
      "mae_dy": 0.0018596977461129427,
      "pose_mae_dtheta": 0.05545572564005852,
      "pose_mae_dx": 0.02052624523639679,
      "pose_mae_dy": 0.017744552344083786,
      "pose_rmse_dtheta": 0.16159778833389282,
      "pose_rmse_dx": 0.06284603476524353,
      "pose_rmse_dy": 0.0431380458176136,
      "pose_rmse_mean": 0.08919396251440048,
      "rmse_dtheta": 0.021585196256637573,
      "rmse_dx": 0.00558522017672658,
      "rmse_dy": 0.004662622697651386,
      "rmse_mean": 0.010611012578010559,
      "rotation_flip": 0.003216911805793643,
      "sparse_tokens": 32137.0,
      "step": 7469,
      "turn_loss": 0.06217610836029053,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.34705445084556774,
      "grad_norm": 0.5088170170783997,
      "learning_rate": 3.179802418518939e-06,
      "loss": 0.082,
      "mae_dtheta": 0.011259629391133785,
      "mae_dx": 0.002588484436273575,
      "mae_dy": 0.0024568354710936546,
      "pose_mae_dtheta": 0.07855451852083206,
      "pose_mae_dx": 0.028046974912285805,
      "pose_mae_dy": 0.02398526668548584,
      "pose_rmse_dtheta": 0.2188187837600708,
      "pose_rmse_dx": 0.08245176821947098,
      "pose_rmse_dy": 0.05618613585829735,
      "pose_rmse_mean": 0.11915223300457001,
      "rmse_dtheta": 0.027683177962899208,
      "rmse_dx": 0.008907871320843697,
      "rmse_dy": 0.007624517194926739,
      "rmse_mean": 0.014738522469997406,
      "rotation_flip": 0.004316546954214573,
      "sparse_tokens": 32089.0,
      "step": 7470,
      "turn_loss": 0.0921165943145752,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3471009106114105,
      "grad_norm": 0.3813774585723877,
      "learning_rate": 3.178570989091028e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.011599535122513771,
      "mae_dx": 0.0015184978256002069,
      "mae_dy": 0.002291913377121091,
      "pose_mae_dtheta": 0.07014315575361252,
      "pose_mae_dx": 0.018857885152101517,
      "pose_mae_dy": 0.027072597295045853,
      "pose_rmse_dtheta": 0.18295514583587646,
      "pose_rmse_dx": 0.04510163515806198,
      "pose_rmse_dy": 0.060286469757556915,
      "pose_rmse_mean": 0.09611441940069199,
      "rmse_dtheta": 0.02533865161240101,
      "rmse_dx": 0.004587139002978802,
      "rmse_dy": 0.004853732883930206,
      "rmse_mean": 0.011593174189329147,
      "rotation_flip": 0.005606166552752256,
      "sparse_tokens": 32121.0,
      "step": 7471,
      "turn_loss": 0.08453638106584549,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3471473703772533,
      "grad_norm": 0.4185624420642853,
      "learning_rate": 3.177339687036628e-06,
      "loss": 0.0813,
      "mae_dtheta": 0.013439693488180637,
      "mae_dx": 0.0018599715549498796,
      "mae_dy": 0.002590188989415765,
      "pose_mae_dtheta": 0.0882783830165863,
      "pose_mae_dx": 0.023088255897164345,
      "pose_mae_dy": 0.0321446917951107,
      "pose_rmse_dtheta": 0.18426348268985748,
      "pose_rmse_dx": 0.05456966161727905,
      "pose_rmse_dy": 0.07785352319478989,
      "pose_rmse_mean": 0.105562224984169,
      "rmse_dtheta": 0.025154421105980873,
      "rmse_dx": 0.005494814366102219,
      "rmse_dy": 0.0050182160921394825,
      "rmse_mean": 0.01188915129750967,
      "rotation_flip": 0.011295180767774582,
      "sparse_tokens": 32121.0,
      "step": 7472,
      "turn_loss": 0.11287610232830048,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.34719383014309607,
      "grad_norm": 0.4940766394138336,
      "learning_rate": 3.176108512441839e-06,
      "loss": 0.1337,
      "mae_dtheta": 0.031030820682644844,
      "mae_dx": 0.00890066847205162,
      "mae_dy": 0.002458428032696247,
      "pose_mae_dtheta": 0.2277395874261856,
      "pose_mae_dx": 0.0749160498380661,
      "pose_mae_dy": 0.027114935219287872,
      "pose_rmse_dtheta": 0.46846795082092285,
      "pose_rmse_dx": 0.20812855660915375,
      "pose_rmse_dy": 0.0723559707403183,
      "pose_rmse_mean": 0.24965083599090576,
      "rmse_dtheta": 0.052286505699157715,
      "rmse_dx": 0.021116772666573524,
      "rmse_dy": 0.005243612453341484,
      "rmse_mean": 0.026215631514787674,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 15997.0,
      "step": 7473,
      "turn_loss": 0.21821928024291992,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.34724028990893885,
      "grad_norm": 0.5594415068626404,
      "learning_rate": 3.1748774653927626e-06,
      "loss": 0.1625,
      "mae_dtheta": 0.011971153318881989,
      "mae_dx": 0.002287469105795026,
      "mae_dy": 0.003936664201319218,
      "pose_mae_dtheta": 0.0854397565126419,
      "pose_mae_dx": 0.03234250843524933,
      "pose_mae_dy": 0.036644432693719864,
      "pose_rmse_dtheta": 0.19557246565818787,
      "pose_rmse_dx": 0.09127177298069,
      "pose_rmse_dy": 0.07992301136255264,
      "pose_rmse_mean": 0.12225575745105743,
      "rmse_dtheta": 0.023657670244574547,
      "rmse_dx": 0.007476064842194319,
      "rmse_dy": 0.008414624258875847,
      "rmse_mean": 0.013182787224650383,
      "rotation_flip": 0.0014716703444719315,
      "sparse_tokens": 32041.0,
      "step": 7474,
      "turn_loss": 0.10141332447528839,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3472867496747816,
      "grad_norm": 0.6561822295188904,
      "learning_rate": 3.1736465459754835e-06,
      "loss": 0.1571,
      "mae_dtheta": 0.008113856427371502,
      "mae_dx": 0.001641026814468205,
      "mae_dy": 0.0012912886450067163,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6561823487281799,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 169.8507843017578,
      "model/head/act_norm_mean": 120.43534958964646,
      "model/head/act_norm_min": 70.1678237915039,
      "model/head/act_over_embed": 82.76429977151248,
      "model/head/grad_frac": 0.08852523565292358,
      "model/head/grad_norm": 0.058088697493076324,
      "model/head/grad_zero_frac": 0.0001986121351365,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6981238162878788,
      "model/head/update_ratio": 0.0009902275633066893,
      "model/head/weight_delta": 9.540831565856934,
      "model/head/weight_delta_rel": 0.16737444698810577,
      "model/head/weight_norm": 58.66196823120117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4221072196960449,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42205224426007576,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4219880998134613,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2900382535708888,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07987553626298904,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05241291597485542,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5402528165236051,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016928567783907056,
      "model/modality_embedder.encoders.pose/weight_delta": 3.059793710708618,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09997300058603287,
      "model/modality_embedder.encoders.pose/weight_norm": 30.961223602294922,
      "model/modality_embedder/grad_frac": 0.07987553626298904,
      "model/modality_embedder/grad_norm": 0.05241291597485542,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5402528165236051,
      "model/modality_embedder/update_ratio": 0.0016928567783907056,
      "model/modality_embedder/weight_delta": 3.059793710708618,
      "model/modality_embedder/weight_delta_rel": 0.09997300058603287,
      "model/modality_embedder/weight_norm": 30.961223602294922,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 98.07701110839844,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.670812790604458,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.035920143127441,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.95401352149175,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06415726244449615,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.042098864912986755,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000363137514796108,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015081723686307669,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5278375148773193,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09211592376232147,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.913827896118164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 99.94173431396484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.704921236171238,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.127525329589844,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.66466252676104,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06603725254535675,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.043332479894161224,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014593268278986216,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2068679332733154,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11108841001987457,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.693471908569336,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 101.63402557373047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.5491822991823,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.238134384155273,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.93205599550635,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07297615706920624,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04788566753268242,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015618221368640661,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.4639835357666016,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11631408333778381,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.660127639770508,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 102.23517608642578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.248667227833895,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.95390796661377,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.099957949304308,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0795588344335556,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.052205104380846024,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017464355332776904,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.9650840759277344,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10133250057697296,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.89237403869629,
      "model/normalizer/grad_frac": 0.31175297498703003,
      "model/normalizer/grad_norm": 0.2045668065547943,
      "model/normalizer/grad_zero_frac": 0.0002517102693673223,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0026035706978291273,
      "model/normalizer/weight_delta": 6.26332426071167,
      "model/normalizer/weight_delta_rel": 0.08066798746585846,
      "model/normalizer/weight_norm": 78.5716323852539,
      "pose_mae_dtheta": 0.05649904906749725,
      "pose_mae_dx": 0.01668122410774231,
      "pose_mae_dy": 0.015250731259584427,
      "pose_rmse_dtheta": 0.18443691730499268,
      "pose_rmse_dx": 0.04569103568792343,
      "pose_rmse_dy": 0.04875800758600235,
      "pose_rmse_mean": 0.09296198934316635,
      "rmse_dtheta": 0.021567165851593018,
      "rmse_dx": 0.004649925511330366,
      "rmse_dy": 0.0038936161436140537,
      "rmse_mean": 0.010036902502179146,
      "rotation_flip": 0.009442870505154133,
      "sparse_tokens": 32185.0,
      "step": 7475,
      "turn_loss": 0.06584852188825607,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3473332094406244,
      "grad_norm": 0.37837934494018555,
      "learning_rate": 3.172415754276082e-06,
      "loss": 0.0685,
      "mae_dtheta": 0.005406346172094345,
      "mae_dx": 0.0012900650035589933,
      "mae_dy": 0.0008371032890863717,
      "pose_mae_dtheta": 0.03883471339941025,
      "pose_mae_dx": 0.011012430302798748,
      "pose_mae_dy": 0.01001285482198,
      "pose_rmse_dtheta": 0.12413312494754791,
      "pose_rmse_dx": 0.028949949890375137,
      "pose_rmse_dy": 0.033782292157411575,
      "pose_rmse_mean": 0.06228845566511154,
      "rmse_dtheta": 0.01625700667500496,
      "rmse_dx": 0.004060726147145033,
      "rmse_dy": 0.0028429534286260605,
      "rmse_mean": 0.0077202292159199715,
      "rotation_flip": 0.004248539451509714,
      "sparse_tokens": 32153.0,
      "step": 7476,
      "turn_loss": 0.04253700003027916,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37846.0,
      "epoch": 0.3473796692064672,
      "grad_norm": 0.5399218797683716,
      "learning_rate": 3.171185090380628e-06,
      "loss": 0.1933,
      "mae_dtheta": 0.03962321579456329,
      "mae_dx": 0.010324488393962383,
      "mae_dy": 0.005399004090577364,
      "pose_mae_dtheta": 0.3390498459339142,
      "pose_mae_dx": 0.07885577529668808,
      "pose_mae_dy": 0.06341675668954849,
      "pose_rmse_dtheta": 0.5731260180473328,
      "pose_rmse_dx": 0.15910640358924866,
      "pose_rmse_dy": 0.15335573256015778,
      "pose_rmse_mean": 0.2951960563659668,
      "rmse_dtheta": 0.05752651020884514,
      "rmse_dx": 0.02086009457707405,
      "rmse_dy": 0.010677491314709187,
      "rmse_mean": 0.0296880342066288,
      "rotation_flip": 0.012870732694864273,
      "sparse_tokens": 29746.0,
      "step": 7477,
      "turn_loss": 0.2918764352798462,
      "turns": 117.0,
      "turns_per_sample": 117.0
    },
    {
      "dense_tokens": 11021.0,
      "epoch": 0.34742612897230996,
      "grad_norm": 0.7278814911842346,
      "learning_rate": 3.169954554375182e-06,
      "loss": 0.1725,
      "mae_dtheta": 0.0329187735915184,
      "mae_dx": 0.010417765006422997,
      "mae_dy": 0.0067303236573934555,
      "pose_mae_dtheta": 0.23712019622325897,
      "pose_mae_dx": 0.09426573663949966,
      "pose_mae_dy": 0.11897505074739456,
      "pose_rmse_dtheta": 0.4374047517776489,
      "pose_rmse_dx": 0.21984364092350006,
      "pose_rmse_dy": 0.23210826516151428,
      "pose_rmse_mean": 0.29645222425460815,
      "rmse_dtheta": 0.047761548310518265,
      "rmse_dx": 0.02396206744015217,
      "rmse_dy": 0.01092997845262289,
      "rmse_mean": 0.02755120024085045,
      "rotation_flip": 0.011009174399077892,
      "sparse_tokens": 8911.0,
      "step": 7478,
      "turn_loss": 0.3041331470012665,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.34747258873815273,
      "grad_norm": 0.29839086532592773,
      "learning_rate": 3.168724146345796e-06,
      "loss": 0.0805,
      "mae_dtheta": 0.023510240018367767,
      "mae_dx": 0.008403615094721317,
      "mae_dy": 0.001703996560536325,
      "pose_mae_dtheta": 0.16592013835906982,
      "pose_mae_dx": 0.06359101831912994,
      "pose_mae_dy": 0.013445688411593437,
      "pose_rmse_dtheta": 0.3074864447116852,
      "pose_rmse_dx": 0.17880192399024963,
      "pose_rmse_dy": 0.033603426069021225,
      "pose_rmse_mean": 0.17329727113246918,
      "rmse_dtheta": 0.041345518082380295,
      "rmse_dx": 0.019363516941666603,
      "rmse_dy": 0.003733899677172303,
      "rmse_mean": 0.0214809812605381,
      "rotation_flip": 0.0031645570416003466,
      "sparse_tokens": 5248.0,
      "step": 7479,
      "turn_loss": 0.15641175210475922,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.34751904850399556,
      "grad_norm": 0.5067691802978516,
      "learning_rate": 3.167493866378514e-06,
      "loss": 0.127,
      "mae_dtheta": 0.03479647636413574,
      "mae_dx": 0.009934873320162296,
      "mae_dy": 0.0034344939049333334,
      "pose_mae_dtheta": 0.2666914463043213,
      "pose_mae_dx": 0.0756760835647583,
      "pose_mae_dy": 0.03918270766735077,
      "pose_rmse_dtheta": 0.47826236486434937,
      "pose_rmse_dx": 0.17213788628578186,
      "pose_rmse_dy": 0.09556972980499268,
      "pose_rmse_mean": 0.24865667521953583,
      "rmse_dtheta": 0.05551746487617493,
      "rmse_dx": 0.02083193138241768,
      "rmse_dy": 0.006957021541893482,
      "rmse_mean": 0.027768805623054504,
      "rotation_flip": 0.010989011265337467,
      "sparse_tokens": 18805.0,
      "step": 7480,
      "turn_loss": 0.24652099609375,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.34756550826983834,
      "grad_norm": 0.5262323021888733,
      "learning_rate": 3.16626371455937e-06,
      "loss": 0.1302,
      "mae_dtheta": 0.009097996167838573,
      "mae_dx": 0.0015194654697552323,
      "mae_dy": 0.002155359834432602,
      "pose_mae_dtheta": 0.061546020209789276,
      "pose_mae_dx": 0.016269903630018234,
      "pose_mae_dy": 0.020624611526727676,
      "pose_rmse_dtheta": 0.19784167408943176,
      "pose_rmse_dx": 0.042570505291223526,
      "pose_rmse_dy": 0.052531566470861435,
      "pose_rmse_mean": 0.09764792025089264,
      "rmse_dtheta": 0.02349400334060192,
      "rmse_dx": 0.004263334441930056,
      "rmse_dy": 0.006074770353734493,
      "rmse_mean": 0.011277369223535061,
      "rotation_flip": 0.009126466698944569,
      "sparse_tokens": 32105.0,
      "step": 7481,
      "turn_loss": 0.0754668340086937,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2309.0,
      "epoch": 0.3476119680356811,
      "grad_norm": 0.6686742305755615,
      "learning_rate": 3.165033690974387e-06,
      "loss": 0.1504,
      "mae_dtheta": 0.053380027413368225,
      "mae_dx": 0.036933016031980515,
      "mae_dy": 0.030227456241846085,
      "pose_mae_dtheta": 0.36809009313583374,
      "pose_mae_dx": 0.2348126769065857,
      "pose_mae_dy": 0.34094977378845215,
      "pose_rmse_dtheta": 0.5735132694244385,
      "pose_rmse_dx": 0.38997024297714233,
      "pose_rmse_dy": 0.45267626643180847,
      "pose_rmse_mean": 0.47205325961112976,
      "rmse_dtheta": 0.06927453726530075,
      "rmse_dx": 0.04515206813812256,
      "rmse_dy": 0.034576334059238434,
      "rmse_mean": 0.04966764897108078,
      "rotation_flip": 0.02500000037252903,
      "sparse_tokens": 1980.0,
      "step": 7482,
      "turn_loss": 0.6320285797119141,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3476584278015239,
      "grad_norm": 0.369866281747818,
      "learning_rate": 3.1638037957095836e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.01032179594039917,
      "mae_dx": 0.0020653523970395327,
      "mae_dy": 0.0015471199294552207,
      "pose_mae_dtheta": 0.0796918049454689,
      "pose_mae_dx": 0.023547902703285217,
      "pose_mae_dy": 0.026966886594891548,
      "pose_rmse_dtheta": 0.2183832824230194,
      "pose_rmse_dx": 0.06099876016378403,
      "pose_rmse_dy": 0.06771966814994812,
      "pose_rmse_mean": 0.11570057272911072,
      "rmse_dtheta": 0.024626702070236206,
      "rmse_dx": 0.006455622613430023,
      "rmse_dy": 0.0036412235349416733,
      "rmse_mean": 0.011574517004191875,
      "rotation_flip": 0.0032407406251877546,
      "sparse_tokens": 32105.0,
      "step": 7483,
      "turn_loss": 0.07329880446195602,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.34770488756736667,
      "grad_norm": 0.4525020718574524,
      "learning_rate": 3.1625740288509677e-06,
      "loss": 0.1083,
      "mae_dtheta": 0.03287220746278763,
      "mae_dx": 0.007090912666171789,
      "mae_dy": 0.004305961076170206,
      "pose_mae_dtheta": 0.26648595929145813,
      "pose_mae_dx": 0.0707295686006546,
      "pose_mae_dy": 0.05642961338162422,
      "pose_rmse_dtheta": 0.5403162240982056,
      "pose_rmse_dx": 0.1812441349029541,
      "pose_rmse_dy": 0.1330796182155609,
      "pose_rmse_mean": 0.28488001227378845,
      "rmse_dtheta": 0.05569333955645561,
      "rmse_dx": 0.018788756802678108,
      "rmse_dy": 0.009633339010179043,
      "rmse_mean": 0.028038479387760162,
      "rotation_flip": 0.009868420660495758,
      "sparse_tokens": 13424.0,
      "step": 7484,
      "turn_loss": 0.19085995852947235,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.34775134733320945,
      "grad_norm": 1.146899938583374,
      "learning_rate": 3.1613443904845338e-06,
      "loss": 0.221,
      "mae_dtheta": 0.027366114780306816,
      "mae_dx": 0.008698043413460255,
      "mae_dy": 0.00419908482581377,
      "pose_mae_dtheta": 0.20783595740795135,
      "pose_mae_dx": 0.06301403790712357,
      "pose_mae_dy": 0.052355822175741196,
      "pose_rmse_dtheta": 0.40726950764656067,
      "pose_rmse_dx": 0.16106803715229034,
      "pose_rmse_dy": 0.1256580352783203,
      "pose_rmse_mean": 0.23133186995983124,
      "rmse_dtheta": 0.045410677790641785,
      "rmse_dx": 0.019858095794916153,
      "rmse_dy": 0.00777913024649024,
      "rmse_mean": 0.02434930019080639,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 8491.0,
      "step": 7485,
      "turn_loss": 0.2286701798439026,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.3477978070990522,
      "grad_norm": 0.7787870764732361,
      "learning_rate": 3.1601148806962757e-06,
      "loss": 0.1497,
      "mae_dtheta": 0.029659871011972427,
      "mae_dx": 0.01087689958512783,
      "mae_dy": 0.011713875457644463,
      "pose_mae_dtheta": 0.22450119256973267,
      "pose_mae_dx": 0.08991623669862747,
      "pose_mae_dy": 0.11731816083192825,
      "pose_rmse_dtheta": 0.4431021809577942,
      "pose_rmse_dx": 0.18112191557884216,
      "pose_rmse_dy": 0.28150221705436707,
      "pose_rmse_mean": 0.30190879106521606,
      "rmse_dtheta": 0.04955299198627472,
      "rmse_dx": 0.02045895904302597,
      "rmse_dy": 0.023974474519491196,
      "rmse_mean": 0.03132880851626396,
      "rotation_flip": 0.01666666753590107,
      "sparse_tokens": 5545.0,
      "step": 7486,
      "turn_loss": 0.28762656450271606,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 6824.0,
      "epoch": 0.347844266864895,
      "grad_norm": 0.5398891568183899,
      "learning_rate": 3.1588854995721694e-06,
      "loss": 0.1265,
      "mae_dtheta": 0.02418499067425728,
      "mae_dx": 0.004961702506989241,
      "mae_dy": 0.0050024730153381824,
      "pose_mae_dtheta": 0.17537540197372437,
      "pose_mae_dx": 0.05091114342212677,
      "pose_mae_dy": 0.07985449582338333,
      "pose_rmse_dtheta": 0.3541547954082489,
      "pose_rmse_dx": 0.14014625549316406,
      "pose_rmse_dy": 0.14013807475566864,
      "pose_rmse_mean": 0.21147970855236053,
      "rmse_dtheta": 0.03905908763408661,
      "rmse_dx": 0.015065202489495277,
      "rmse_dy": 0.009842687286436558,
      "rmse_mean": 0.021322324872016907,
      "rotation_flip": 0.017667844891548157,
      "sparse_tokens": 5312.0,
      "step": 7487,
      "turn_loss": 0.19725044071674347,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 38938.0,
      "epoch": 0.3478907266307378,
      "grad_norm": 0.5507925748825073,
      "learning_rate": 3.157656247198191e-06,
      "loss": 0.1509,
      "mae_dtheta": 0.03312843292951584,
      "mae_dx": 0.011254235170781612,
      "mae_dy": 0.0039787376299500465,
      "pose_mae_dtheta": 0.2576885223388672,
      "pose_mae_dx": 0.09829466789960861,
      "pose_mae_dy": 0.04607445374131203,
      "pose_rmse_dtheta": 0.45235157012939453,
      "pose_rmse_dx": 0.21888668835163116,
      "pose_rmse_dy": 0.11221823841333389,
      "pose_rmse_mean": 0.2611521780490875,
      "rmse_dtheta": 0.05088933929800987,
      "rmse_dx": 0.02329924702644348,
      "rmse_dy": 0.0078070140443742275,
      "rmse_mean": 0.027331870049238205,
      "rotation_flip": 0.010303030721843243,
      "sparse_tokens": 29938.0,
      "step": 7488,
      "turn_loss": 0.242929607629776,
      "turns": 120.0,
      "turns_per_sample": 120.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.34793718639658056,
      "grad_norm": 0.7129958271980286,
      "learning_rate": 3.156427123660297e-06,
      "loss": 0.1925,
      "mae_dtheta": 0.030583571642637253,
      "mae_dx": 0.011179091408848763,
      "mae_dy": 0.007574237883090973,
      "pose_mae_dtheta": 0.2601087987422943,
      "pose_mae_dx": 0.08226587623357773,
      "pose_mae_dy": 0.1328641027212143,
      "pose_rmse_dtheta": 0.4269471764564514,
      "pose_rmse_dx": 0.17364288866519928,
      "pose_rmse_dy": 0.26063498854637146,
      "pose_rmse_mean": 0.287075012922287,
      "rmse_dtheta": 0.04552430659532547,
      "rmse_dx": 0.0240806732326746,
      "rmse_dy": 0.01286365557461977,
      "rmse_mean": 0.027489546686410904,
      "rotation_flip": 0.019108280539512634,
      "sparse_tokens": 12937.0,
      "step": 7489,
      "turn_loss": 0.25410792231559753,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.34798364616242333,
      "grad_norm": 0.7085971236228943,
      "learning_rate": 3.1551981290444444e-06,
      "loss": 0.1537,
      "mae_dtheta": 0.023985207080841064,
      "mae_dx": 0.008677981793880463,
      "mae_dy": 0.004631770774722099,
      "pose_mae_dtheta": 0.18610036373138428,
      "pose_mae_dx": 0.07711685448884964,
      "pose_mae_dy": 0.07856582850217819,
      "pose_rmse_dtheta": 0.3376419246196747,
      "pose_rmse_dx": 0.19968028366565704,
      "pose_rmse_dy": 0.1789521723985672,
      "pose_rmse_mean": 0.2387581318616867,
      "rmse_dtheta": 0.040318407118320465,
      "rmse_dx": 0.021366693079471588,
      "rmse_dy": 0.009449264034628868,
      "rmse_mean": 0.02371145598590374,
      "rotation_flip": 0.014563106931746006,
      "sparse_tokens": 11848.0,
      "step": 7490,
      "turn_loss": 0.17413805425167084,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.3480301059282661,
      "grad_norm": 0.6577135920524597,
      "learning_rate": 3.1539692634365788e-06,
      "loss": 0.148,
      "mae_dtheta": 0.027993328869342804,
      "mae_dx": 0.014264486730098724,
      "mae_dy": 0.006125763989984989,
      "pose_mae_dtheta": 0.20167511701583862,
      "pose_mae_dx": 0.11537599563598633,
      "pose_mae_dy": 0.07778814435005188,
      "pose_rmse_dtheta": 0.3342408835887909,
      "pose_rmse_dx": 0.24107898771762848,
      "pose_rmse_dy": 0.15939196944236755,
      "pose_rmse_mean": 0.24490396678447723,
      "rmse_dtheta": 0.04152313619852066,
      "rmse_dx": 0.028693469241261482,
      "rmse_dy": 0.009946898557245731,
      "rmse_mean": 0.02672116830945015,
      "rotation_flip": 0.00909090880304575,
      "sparse_tokens": 9466.0,
      "step": 7491,
      "turn_loss": 0.27945709228515625,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.3480765656941089,
      "grad_norm": 0.5418699979782104,
      "learning_rate": 3.152740526922631e-06,
      "loss": 0.1333,
      "mae_dtheta": 0.03152813762426376,
      "mae_dx": 0.008974384516477585,
      "mae_dy": 0.005534199066460133,
      "pose_mae_dtheta": 0.2296091467142105,
      "pose_mae_dx": 0.07371772080659866,
      "pose_mae_dy": 0.059804949909448624,
      "pose_rmse_dtheta": 0.42012667655944824,
      "pose_rmse_dx": 0.19263912737369537,
      "pose_rmse_dy": 0.13456304371356964,
      "pose_rmse_mean": 0.24910961091518402,
      "rmse_dtheta": 0.05147085338830948,
      "rmse_dx": 0.020746571943163872,
      "rmse_dy": 0.012194300070405006,
      "rmse_mean": 0.028137242421507835,
      "rotation_flip": 0.011278195306658745,
      "sparse_tokens": 21162.0,
      "step": 7492,
      "turn_loss": 0.2501377761363983,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.34812302545995166,
      "grad_norm": 0.3168700337409973,
      "learning_rate": 3.1515119195885324e-06,
      "loss": 0.0672,
      "mae_dtheta": 0.009405420161783695,
      "mae_dx": 0.0011537595419213176,
      "mae_dy": 0.002088634530082345,
      "pose_mae_dtheta": 0.05422529578208923,
      "pose_mae_dx": 0.014592421241104603,
      "pose_mae_dy": 0.022370364516973495,
      "pose_rmse_dtheta": 0.14060288667678833,
      "pose_rmse_dx": 0.03359390050172806,
      "pose_rmse_dy": 0.045085608959198,
      "pose_rmse_mean": 0.07309412956237793,
      "rmse_dtheta": 0.02114534005522728,
      "rmse_dx": 0.0031932624988257885,
      "rmse_dy": 0.0041783093474805355,
      "rmse_mean": 0.009505637921392918,
      "rotation_flip": 0.003855590708553791,
      "sparse_tokens": 32105.0,
      "step": 7493,
      "turn_loss": 0.06461972743272781,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.34816948522579444,
      "grad_norm": 0.5180149078369141,
      "learning_rate": 3.1502834415201944e-06,
      "loss": 0.1306,
      "mae_dtheta": 0.03357919678092003,
      "mae_dx": 0.015009545721113682,
      "mae_dy": 0.004994459915906191,
      "pose_mae_dtheta": 0.2813262343406677,
      "pose_mae_dx": 0.11428343504667282,
      "pose_mae_dy": 0.04476181045174599,
      "pose_rmse_dtheta": 0.4410006105899811,
      "pose_rmse_dx": 0.24183976650238037,
      "pose_rmse_dy": 0.09911131113767624,
      "pose_rmse_mean": 0.2606505751609802,
      "rmse_dtheta": 0.04821764677762985,
      "rmse_dx": 0.027548573911190033,
      "rmse_dy": 0.008877533487975597,
      "rmse_mean": 0.028214585036039352,
      "rotation_flip": 0.012729844078421593,
      "sparse_tokens": 12518.0,
      "step": 7494,
      "turn_loss": 0.30878859758377075,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.3482159449916372,
      "grad_norm": 0.6444825530052185,
      "learning_rate": 3.1490550928035312e-06,
      "loss": 0.1236,
      "mae_dtheta": 0.025941193103790283,
      "mae_dx": 0.013120884075760841,
      "mae_dy": 0.0042944662272930145,
      "pose_mae_dtheta": 0.19996044039726257,
      "pose_mae_dx": 0.13790391385555267,
      "pose_mae_dy": 0.046006761491298676,
      "pose_rmse_dtheta": 0.34423503279685974,
      "pose_rmse_dx": 0.25254103541374207,
      "pose_rmse_dy": 0.0796017050743103,
      "pose_rmse_mean": 0.2254592627286911,
      "rmse_dtheta": 0.040029194205999374,
      "rmse_dx": 0.02462882176041603,
      "rmse_dy": 0.006576546933501959,
      "rmse_mean": 0.0237448550760746,
      "rotation_flip": 0.013636363670229912,
      "sparse_tokens": 4262.0,
      "step": 7495,
      "turn_loss": 0.24266259372234344,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.34826240475748005,
      "grad_norm": 0.6302491426467896,
      "learning_rate": 3.147826873524436e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.020070267841219902,
      "mae_dx": 0.007306287065148354,
      "mae_dy": 0.0028758528642356396,
      "pose_mae_dtheta": 0.14977909624576569,
      "pose_mae_dx": 0.0736226737499237,
      "pose_mae_dy": 0.05192998796701431,
      "pose_rmse_dtheta": 0.3124673664569855,
      "pose_rmse_dx": 0.19886375963687897,
      "pose_rmse_dy": 0.12327151000499725,
      "pose_rmse_mean": 0.21153423190116882,
      "rmse_dtheta": 0.03647013381123543,
      "rmse_dx": 0.019869275391101837,
      "rmse_dy": 0.006116201635450125,
      "rmse_mean": 0.02081853710114956,
      "rotation_flip": 0.009041591547429562,
      "sparse_tokens": 11984.0,
      "step": 7496,
      "turn_loss": 0.13223621249198914,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3483088645233228,
      "grad_norm": 0.3775070905685425,
      "learning_rate": 3.1465987837688027e-06,
      "loss": 0.0717,
      "mae_dtheta": 0.008937595412135124,
      "mae_dx": 0.0011006222339347005,
      "mae_dy": 0.0016553513705730438,
      "pose_mae_dtheta": 0.0633620098233223,
      "pose_mae_dx": 0.01634296402335167,
      "pose_mae_dy": 0.021572861820459366,
      "pose_rmse_dtheta": 0.2203158438205719,
      "pose_rmse_dx": 0.04394549876451492,
      "pose_rmse_dy": 0.053954511880874634,
      "pose_rmse_mean": 0.10607194900512695,
      "rmse_dtheta": 0.02367263473570347,
      "rmse_dx": 0.002978255972266197,
      "rmse_dy": 0.00387024087831378,
      "rmse_mean": 0.010173710994422436,
      "rotation_flip": 0.0009165902738459408,
      "sparse_tokens": 32089.0,
      "step": 7497,
      "turn_loss": 0.0635380819439888,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3483553242891656,
      "grad_norm": 0.5081952810287476,
      "learning_rate": 3.145370823622512e-06,
      "loss": 0.0871,
      "mae_dtheta": 0.010825777426362038,
      "mae_dx": 0.0014816641341894865,
      "mae_dy": 0.002089021261781454,
      "pose_mae_dtheta": 0.06885353475809097,
      "pose_mae_dx": 0.019032808020710945,
      "pose_mae_dy": 0.025783026590943336,
      "pose_rmse_dtheta": 0.17240947484970093,
      "pose_rmse_dx": 0.045124784111976624,
      "pose_rmse_dy": 0.0536300353705883,
      "pose_rmse_mean": 0.09038810431957245,
      "rmse_dtheta": 0.02269105240702629,
      "rmse_dx": 0.004774175584316254,
      "rmse_dy": 0.0044627743773162365,
      "rmse_mean": 0.01064266823232174,
      "rotation_flip": 0.005428881850093603,
      "sparse_tokens": 32121.0,
      "step": 7498,
      "turn_loss": 0.07249757647514343,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30078.0,
      "epoch": 0.3484017840550084,
      "grad_norm": 1.0166949033737183,
      "learning_rate": 3.1441429931714345e-06,
      "loss": 0.2746,
      "mae_dtheta": 0.02913813479244709,
      "mae_dx": 0.010549444705247879,
      "mae_dy": 0.004150141961872578,
      "pose_mae_dtheta": 0.24891988933086395,
      "pose_mae_dx": 0.08416768163442612,
      "pose_mae_dy": 0.046284113079309464,
      "pose_rmse_dtheta": 0.46462297439575195,
      "pose_rmse_dx": 0.20251694321632385,
      "pose_rmse_dy": 0.1184588074684143,
      "pose_rmse_mean": 0.2618662416934967,
      "rmse_dtheta": 0.04892469942569733,
      "rmse_dx": 0.02297430858016014,
      "rmse_dy": 0.008489584550261497,
      "rmse_mean": 0.02679619938135147,
      "rotation_flip": 0.009337861090898514,
      "sparse_tokens": 23713.0,
      "step": 7499,
      "turn_loss": 0.21653713285923004,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.34844824382085116,
      "grad_norm": 0.6345221996307373,
      "learning_rate": 3.1429152925014338e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.009783582761883736,
      "mae_dx": 0.0018171666888520122,
      "mae_dy": 0.0005904209683649242,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6345222592353821,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 167.40904235839844,
      "model/head/act_norm_mean": 127.86174242424242,
      "model/head/act_norm_min": 85.43053436279297,
      "model/head/act_over_embed": 87.86778645443196,
      "model/head/grad_frac": 0.09158273041248322,
      "model/head/grad_norm": 0.0581112802028656,
      "model/head/grad_zero_frac": 0.00015927042113617063,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6884519018308081,
      "model/head/update_ratio": 0.0009905908955261111,
      "model/head/weight_delta": 9.548572540283203,
      "model/head/weight_delta_rel": 0.1675102412700653,
      "model/head/weight_norm": 58.663246154785156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42219534516334534,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42212790030020253,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.422060489654541,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29009024510996695,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10526184737682343,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06679098308086395,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5390464248971193,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0021572313271462917,
      "model/modality_embedder.encoders.pose/weight_delta": 3.060476541519165,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.09999530762434006,
      "model/modality_embedder.encoders.pose/weight_norm": 30.961437225341797,
      "model/modality_embedder/grad_frac": 0.10526184737682343,
      "model/modality_embedder/grad_norm": 0.06679098308086395,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5390464248971193,
      "model/modality_embedder/update_ratio": 0.0021572313271462917,
      "model/modality_embedder/weight_delta": 3.060476541519165,
      "model/modality_embedder/weight_delta_rel": 0.09999530762434006,
      "model/modality_embedder/weight_norm": 30.961437225341797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 96.56704711914062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.398245851370852,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.973508834838867,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.45391233118603,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05593688413500786,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03549319878220558,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012714852346107364,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.531087875366211,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09223437309265137,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.91475486755371,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 98.19195556640625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.43910584014751,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.197162628173828,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.16920106015809,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0527346171438694,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03346128761768341,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011268405942246318,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.211155891418457,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11123695224523544,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.69478416442871,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 99.90779876708984,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.253236732403398,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.551602363586426,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.415888793477343,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.054361432790756226,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03449353948235512,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011249788803979754,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.4685349464416504,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11646690964698792,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.6614990234375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 100.50627899169922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.912490480198812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.23011589050293,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.55614350314068,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0637296810746193,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04043789952993393,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001352752442471683,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.96916127204895,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10147184133529663,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.893051147460938,
      "model/normalizer/grad_frac": 0.21759386360645294,
      "model/normalizer/grad_norm": 0.13806815445423126,
      "model/normalizer/grad_zero_frac": 0.00019144162070006132,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017571968492120504,
      "model/normalizer/weight_delta": 6.271646022796631,
      "model/normalizer/weight_delta_rel": 0.0807751715183258,
      "model/normalizer/weight_norm": 78.57295989990234,
      "pose_mae_dtheta": 0.0702594444155693,
      "pose_mae_dx": 0.014810501597821712,
      "pose_mae_dy": 0.008135885000228882,
      "pose_rmse_dtheta": 0.2529582977294922,
      "pose_rmse_dx": 0.03228011354804039,
      "pose_rmse_dy": 0.02367316372692585,
      "pose_rmse_mean": 0.10297053307294846,
      "rmse_dtheta": 0.03071521781384945,
      "rmse_dx": 0.004869814496487379,
      "rmse_dy": 0.0015949088847264647,
      "rmse_mean": 0.012393313460052013,
      "rotation_flip": 0.0017699114978313446,
      "sparse_tokens": 32265.0,
      "step": 7500,
      "turn_loss": 0.05745840072631836,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.34849470358669393,
      "grad_norm": 0.5461995005607605,
      "learning_rate": 3.141687721698363e-06,
      "loss": 0.1357,
      "mae_dtheta": 0.031027374789118767,
      "mae_dx": 0.01134856604039669,
      "mae_dy": 0.00513377133756876,
      "pose_mae_dtheta": 0.24559646844863892,
      "pose_mae_dx": 0.09533620625734329,
      "pose_mae_dy": 0.06954208016395569,
      "pose_rmse_dtheta": 0.4372166395187378,
      "pose_rmse_dx": 0.19664208590984344,
      "pose_rmse_dy": 0.1492367535829544,
      "pose_rmse_mean": 0.261031836271286,
      "rmse_dtheta": 0.048746731132268906,
      "rmse_dx": 0.022980161011219025,
      "rmse_dy": 0.008678378537297249,
      "rmse_mean": 0.026801755651831627,
      "rotation_flip": 0.008658008649945259,
      "sparse_tokens": 12665.0,
      "step": 7501,
      "turn_loss": 0.22259517014026642,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.3485411633525367,
      "grad_norm": 0.5273309946060181,
      "learning_rate": 3.1404602808480665e-06,
      "loss": 0.1429,
      "mae_dtheta": 0.04887272045016289,
      "mae_dx": 0.01255120150744915,
      "mae_dy": 0.006567738484591246,
      "pose_mae_dtheta": 0.4181959331035614,
      "pose_mae_dx": 0.12286577373743057,
      "pose_mae_dy": 0.06831616908311844,
      "pose_rmse_dtheta": 0.6521302461624146,
      "pose_rmse_dx": 0.2391623854637146,
      "pose_rmse_dy": 0.13126440346240997,
      "pose_rmse_mean": 0.3408523499965668,
      "rmse_dtheta": 0.0648469477891922,
      "rmse_dx": 0.02368047647178173,
      "rmse_dy": 0.012293932028114796,
      "rmse_mean": 0.0336071215569973,
      "rotation_flip": 0.009367681108415127,
      "sparse_tokens": 7009.0,
      "step": 7502,
      "turn_loss": 0.44330087304115295,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 34063.0,
      "epoch": 0.3485876231183795,
      "grad_norm": 0.48140451312065125,
      "learning_rate": 3.1392329700363834e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.03357481211423874,
      "mae_dx": 0.01129171997308731,
      "mae_dy": 0.004189216997474432,
      "pose_mae_dtheta": 0.2517498731613159,
      "pose_mae_dx": 0.08551698178052902,
      "pose_mae_dy": 0.054366953670978546,
      "pose_rmse_dtheta": 0.46576622128486633,
      "pose_rmse_dx": 0.19325438141822815,
      "pose_rmse_dy": 0.13799311220645905,
      "pose_rmse_mean": 0.2656712532043457,
      "rmse_dtheta": 0.05247042328119278,
      "rmse_dx": 0.023182513192296028,
      "rmse_dy": 0.008438642136752605,
      "rmse_mean": 0.028030525892972946,
      "rotation_flip": 0.011214952915906906,
      "sparse_tokens": 27655.0,
      "step": 7503,
      "turn_loss": 0.2609310448169708,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.34863408288422226,
      "grad_norm": 0.5480788946151733,
      "learning_rate": 3.1380057893491343e-06,
      "loss": 0.1122,
      "mae_dtheta": 0.009283668361604214,
      "mae_dx": 0.0018635160522535443,
      "mae_dy": 0.002537703840062022,
      "pose_mae_dtheta": 0.06847374886274338,
      "pose_mae_dx": 0.02007543109357357,
      "pose_mae_dy": 0.02220788784325123,
      "pose_rmse_dtheta": 0.2090015411376953,
      "pose_rmse_dx": 0.056746114045381546,
      "pose_rmse_dy": 0.06172643229365349,
      "pose_rmse_mean": 0.10915803164243698,
      "rmse_dtheta": 0.024404972791671753,
      "rmse_dx": 0.005978023633360863,
      "rmse_dy": 0.006615805439651012,
      "rmse_mean": 0.012332933954894543,
      "rotation_flip": 0.006103286519646645,
      "sparse_tokens": 32057.0,
      "step": 7504,
      "turn_loss": 0.09445551037788391,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.34868054265006504,
      "grad_norm": 0.6818498373031616,
      "learning_rate": 3.1367787388721427e-06,
      "loss": 0.0801,
      "mae_dtheta": 0.04099639877676964,
      "mae_dx": 0.008637933060526848,
      "mae_dy": 0.003446522168815136,
      "pose_mae_dtheta": 0.34501004219055176,
      "pose_mae_dx": 0.08073664456605911,
      "pose_mae_dy": 0.039431132376194,
      "pose_rmse_dtheta": 0.6312148571014404,
      "pose_rmse_dx": 0.20839370787143707,
      "pose_rmse_dy": 0.10145546495914459,
      "pose_rmse_mean": 0.3136880099773407,
      "rmse_dtheta": 0.06544516235589981,
      "rmse_dx": 0.02094021998345852,
      "rmse_dy": 0.008253770880401134,
      "rmse_mean": 0.03154638409614563,
      "rotation_flip": 0.008196720853447914,
      "sparse_tokens": 3892.0,
      "step": 7505,
      "turn_loss": 0.18277661502361298,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3487270024159078,
      "grad_norm": 0.656959056854248,
      "learning_rate": 3.135551818691211e-06,
      "loss": 0.1815,
      "mae_dtheta": 0.0077770608477294445,
      "mae_dx": 0.0012728041037917137,
      "mae_dy": 0.001674847793765366,
      "pose_mae_dtheta": 0.053964126855134964,
      "pose_mae_dx": 0.014614684507250786,
      "pose_mae_dy": 0.019573567435145378,
      "pose_rmse_dtheta": 0.1380792111158371,
      "pose_rmse_dx": 0.04039058834314346,
      "pose_rmse_dy": 0.04874216020107269,
      "pose_rmse_mean": 0.07573732733726501,
      "rmse_dtheta": 0.019015822559595108,
      "rmse_dx": 0.00436470378190279,
      "rmse_dy": 0.00408017635345459,
      "rmse_mean": 0.009153567254543304,
      "rotation_flip": 0.0014691478572785854,
      "sparse_tokens": 32073.0,
      "step": 7506,
      "turn_loss": 0.06427174061536789,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.3487734621817506,
      "grad_norm": 0.39142271876335144,
      "learning_rate": 3.1343250288921438e-06,
      "loss": 0.0971,
      "mae_dtheta": 0.03656263276934624,
      "mae_dx": 0.011069388128817081,
      "mae_dy": 0.005213741213083267,
      "pose_mae_dtheta": 0.3031110167503357,
      "pose_mae_dx": 0.08908987790346146,
      "pose_mae_dy": 0.0533001609146595,
      "pose_rmse_dtheta": 0.5129957795143127,
      "pose_rmse_dx": 0.19148752093315125,
      "pose_rmse_dy": 0.14427714049816132,
      "pose_rmse_mean": 0.28292015194892883,
      "rmse_dtheta": 0.054480571299791336,
      "rmse_dx": 0.021987423300743103,
      "rmse_dy": 0.01159343495965004,
      "rmse_mean": 0.029353808611631393,
      "rotation_flip": 0.015540015883743763,
      "sparse_tokens": 21412.0,
      "step": 7507,
      "turn_loss": 0.25813406705856323,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.34881992194759337,
      "grad_norm": 0.3299957513809204,
      "learning_rate": 3.1330983695607265e-06,
      "loss": 0.0866,
      "mae_dtheta": 0.008511677384376526,
      "mae_dx": 0.0016078836051747203,
      "mae_dy": 0.002301976317539811,
      "pose_mae_dtheta": 0.05853452906012535,
      "pose_mae_dx": 0.021077033132314682,
      "pose_mae_dy": 0.029237164184451103,
      "pose_rmse_dtheta": 0.11600553244352341,
      "pose_rmse_dx": 0.04994399845600128,
      "pose_rmse_dy": 0.06518521904945374,
      "pose_rmse_mean": 0.07704491913318634,
      "rmse_dtheta": 0.017702072858810425,
      "rmse_dx": 0.0047247144393622875,
      "rmse_dy": 0.004568627569824457,
      "rmse_mean": 0.00899847224354744,
      "rotation_flip": 0.0031645570416003466,
      "sparse_tokens": 32089.0,
      "step": 7508,
      "turn_loss": 0.0739663690328598,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.34886638171343615,
      "grad_norm": 0.8863550424575806,
      "learning_rate": 3.1318718407827427e-06,
      "loss": 0.1456,
      "mae_dtheta": 0.032423943281173706,
      "mae_dx": 0.009921051561832428,
      "mae_dy": 0.0037359525449573994,
      "pose_mae_dtheta": 0.27404865622520447,
      "pose_mae_dx": 0.08246878534555435,
      "pose_mae_dy": 0.04503219947218895,
      "pose_rmse_dtheta": 0.47206467390060425,
      "pose_rmse_dx": 0.19088862836360931,
      "pose_rmse_dy": 0.10214710980653763,
      "pose_rmse_mean": 0.2550334930419922,
      "rmse_dtheta": 0.049513574689626694,
      "rmse_dx": 0.02169260010123253,
      "rmse_dy": 0.007192725781351328,
      "rmse_mean": 0.026132967323064804,
      "rotation_flip": 0.008756567724049091,
      "sparse_tokens": 10943.0,
      "step": 7509,
      "turn_loss": 0.2019144743680954,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3489128414792789,
      "grad_norm": 0.37509554624557495,
      "learning_rate": 3.1306454426439653e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.0107584148645401,
      "mae_dx": 0.0015728950966149569,
      "mae_dy": 0.0026891285087913275,
      "pose_mae_dtheta": 0.06857675313949585,
      "pose_mae_dx": 0.022259939461946487,
      "pose_mae_dy": 0.03159023076295853,
      "pose_rmse_dtheta": 0.1580590307712555,
      "pose_rmse_dx": 0.05291517823934555,
      "pose_rmse_dy": 0.06757031381130219,
      "pose_rmse_mean": 0.09284818172454834,
      "rmse_dtheta": 0.021512387320399284,
      "rmse_dx": 0.004108557477593422,
      "rmse_dy": 0.0051946938037872314,
      "rmse_mean": 0.010271879844367504,
      "rotation_flip": 0.008846658281981945,
      "sparse_tokens": 32121.0,
      "step": 7510,
      "turn_loss": 0.08676159381866455,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.3489593012451217,
      "grad_norm": 0.5218625664710999,
      "learning_rate": 3.129419175230154e-06,
      "loss": 0.1504,
      "mae_dtheta": 0.03157564625144005,
      "mae_dx": 0.012067131698131561,
      "mae_dy": 0.005905605386942625,
      "pose_mae_dtheta": 0.22646957635879517,
      "pose_mae_dx": 0.09030414372682571,
      "pose_mae_dy": 0.06751701980829239,
      "pose_rmse_dtheta": 0.38982465863227844,
      "pose_rmse_dx": 0.21079830825328827,
      "pose_rmse_dy": 0.1643396019935608,
      "pose_rmse_mean": 0.25498753786087036,
      "rmse_dtheta": 0.04853849858045578,
      "rmse_dx": 0.02501988410949707,
      "rmse_dy": 0.012733211740851402,
      "rmse_mean": 0.028763866052031517,
      "rotation_flip": 0.016914749518036842,
      "sparse_tokens": 23230.0,
      "step": 7511,
      "turn_loss": 0.28038647770881653,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3490057610109645,
      "grad_norm": 0.48211923241615295,
      "learning_rate": 3.128193038627065e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.010082256980240345,
      "mae_dx": 0.0021126859355717897,
      "mae_dy": 0.002271941164508462,
      "pose_mae_dtheta": 0.07247033715248108,
      "pose_mae_dx": 0.022242365404963493,
      "pose_mae_dy": 0.03107740357518196,
      "pose_rmse_dtheta": 0.16996611654758453,
      "pose_rmse_dx": 0.07000583410263062,
      "pose_rmse_dy": 0.07645844668149948,
      "pose_rmse_mean": 0.10547679662704468,
      "rmse_dtheta": 0.021634604781866074,
      "rmse_dx": 0.008449663408100605,
      "rmse_dy": 0.006611312739551067,
      "rmse_mean": 0.012231860309839249,
      "rotation_flip": 0.0034320035483688116,
      "sparse_tokens": 32041.0,
      "step": 7512,
      "turn_loss": 0.08228344470262527,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.3490522207768073,
      "grad_norm": 0.5108337998390198,
      "learning_rate": 3.12696703292044e-06,
      "loss": 0.1118,
      "mae_dtheta": 0.0238326508551836,
      "mae_dx": 0.007397263776510954,
      "mae_dy": 0.0032544387504458427,
      "pose_mae_dtheta": 0.20899896323680878,
      "pose_mae_dx": 0.0589117705821991,
      "pose_mae_dy": 0.04766634851694107,
      "pose_rmse_dtheta": 0.3697613477706909,
      "pose_rmse_dx": 0.17279139161109924,
      "pose_rmse_dy": 0.13373379409313202,
      "pose_rmse_mean": 0.22542884945869446,
      "rmse_dtheta": 0.04238877072930336,
      "rmse_dx": 0.018800336867570877,
      "rmse_dy": 0.007325650658458471,
      "rmse_mean": 0.022838253527879715,
      "rotation_flip": 0.014634146355092525,
      "sparse_tokens": 13040.0,
      "step": 7513,
      "turn_loss": 0.14844025671482086,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.3490986805426501,
      "grad_norm": 0.6200042963027954,
      "learning_rate": 3.1257411581960174e-06,
      "loss": 0.1223,
      "mae_dtheta": 0.03344368189573288,
      "mae_dx": 0.012292979285120964,
      "mae_dy": 0.00580004183575511,
      "pose_mae_dtheta": 0.2808104455471039,
      "pose_mae_dx": 0.11125272512435913,
      "pose_mae_dy": 0.09525744616985321,
      "pose_rmse_dtheta": 0.44964754581451416,
      "pose_rmse_dx": 0.21513336896896362,
      "pose_rmse_dy": 0.1863267421722412,
      "pose_rmse_mean": 0.283702552318573,
      "rmse_dtheta": 0.05060742795467377,
      "rmse_dx": 0.025373583659529686,
      "rmse_dy": 0.01007077842950821,
      "rmse_mean": 0.02868393063545227,
      "rotation_flip": 0.01075268816202879,
      "sparse_tokens": 6973.0,
      "step": 7514,
      "turn_loss": 0.284633606672287,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.34914514030849286,
      "grad_norm": 0.6392061710357666,
      "learning_rate": 3.1245154145395195e-06,
      "loss": 0.1352,
      "mae_dtheta": 0.02091161161661148,
      "mae_dx": 0.00840469729155302,
      "mae_dy": 0.0035167045425623655,
      "pose_mae_dtheta": 0.1545840948820114,
      "pose_mae_dx": 0.07130985707044601,
      "pose_mae_dy": 0.036886513233184814,
      "pose_rmse_dtheta": 0.2482452392578125,
      "pose_rmse_dx": 0.1521397829055786,
      "pose_rmse_dy": 0.08094154298305511,
      "pose_rmse_mean": 0.16044220328330994,
      "rmse_dtheta": 0.03431277349591255,
      "rmse_dx": 0.019150564447045326,
      "rmse_dy": 0.006184595637023449,
      "rmse_mean": 0.019882645457983017,
      "rotation_flip": 0.003508772002533078,
      "sparse_tokens": 9107.0,
      "step": 7515,
      "turn_loss": 0.22501365840435028,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.34919160007433564,
      "grad_norm": 0.3218468427658081,
      "learning_rate": 3.123289802036667e-06,
      "loss": 0.0831,
      "mae_dtheta": 0.013149372301995754,
      "mae_dx": 0.0027628722600638866,
      "mae_dy": 0.003772074356675148,
      "pose_mae_dtheta": 0.09260795265436172,
      "pose_mae_dx": 0.02712896838784218,
      "pose_mae_dy": 0.030220871791243553,
      "pose_rmse_dtheta": 0.27277711033821106,
      "pose_rmse_dx": 0.08414842188358307,
      "pose_rmse_dy": 0.08464424312114716,
      "pose_rmse_mean": 0.1471899449825287,
      "rmse_dtheta": 0.03192663937807083,
      "rmse_dx": 0.008122417144477367,
      "rmse_dy": 0.009693102911114693,
      "rmse_mean": 0.016580721363425255,
      "rotation_flip": 0.0035601265262812376,
      "sparse_tokens": 32105.0,
      "step": 7516,
      "turn_loss": 0.12476171553134918,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3492380598401784,
      "grad_norm": 0.44685253500938416,
      "learning_rate": 3.1220643207731656e-06,
      "loss": 0.066,
      "mae_dtheta": 0.008147034794092178,
      "mae_dx": 0.0015610812697559595,
      "mae_dy": 0.00179156509693712,
      "pose_mae_dtheta": 0.052504993975162506,
      "pose_mae_dx": 0.01745140738785267,
      "pose_mae_dy": 0.023468777537345886,
      "pose_rmse_dtheta": 0.11850062757730484,
      "pose_rmse_dx": 0.043057430535554886,
      "pose_rmse_dy": 0.04885358735918999,
      "pose_rmse_mean": 0.07013721764087677,
      "rmse_dtheta": 0.017414629459381104,
      "rmse_dx": 0.00486172828823328,
      "rmse_dy": 0.0035067424178123474,
      "rmse_mean": 0.00859436672180891,
      "rotation_flip": 0.003880070522427559,
      "sparse_tokens": 32121.0,
      "step": 7517,
      "turn_loss": 0.06639000028371811,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3492845196060212,
      "grad_norm": 0.5239030718803406,
      "learning_rate": 3.120838970834714e-06,
      "loss": 0.157,
      "mae_dtheta": 0.010698932223021984,
      "mae_dx": 0.0020204621832817793,
      "mae_dy": 0.002936076605692506,
      "pose_mae_dtheta": 0.07479505240917206,
      "pose_mae_dx": 0.028290079906582832,
      "pose_mae_dy": 0.029644083231687546,
      "pose_rmse_dtheta": 0.186199352145195,
      "pose_rmse_dx": 0.07464589178562164,
      "pose_rmse_dy": 0.07127819210290909,
      "pose_rmse_mean": 0.11070781201124191,
      "rmse_dtheta": 0.022579776123166084,
      "rmse_dx": 0.005447486415505409,
      "rmse_dy": 0.006555506493896246,
      "rmse_mean": 0.01152758952230215,
      "rotation_flip": 0.006280530244112015,
      "sparse_tokens": 32137.0,
      "step": 7518,
      "turn_loss": 0.0888691395521164,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.34933097937186397,
      "grad_norm": 0.38844138383865356,
      "learning_rate": 3.119613752307002e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.010293264873325825,
      "mae_dx": 0.0012460093712434173,
      "mae_dy": 0.001525912550278008,
      "pose_mae_dtheta": 0.06937117129564285,
      "pose_mae_dx": 0.012640620581805706,
      "pose_mae_dy": 0.01870342157781124,
      "pose_rmse_dtheta": 0.20335035026073456,
      "pose_rmse_dx": 0.03463629260659218,
      "pose_rmse_dy": 0.053666505962610245,
      "pose_rmse_mean": 0.09721772372722626,
      "rmse_dtheta": 0.026303336024284363,
      "rmse_dx": 0.004452467896044254,
      "rmse_dy": 0.004459553863853216,
      "rmse_mean": 0.01173845212906599,
      "rotation_flip": 0.0032588455360382795,
      "sparse_tokens": 32105.0,
      "step": 7519,
      "turn_loss": 0.07263901829719543,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7147.0,
      "epoch": 0.34937743913770675,
      "grad_norm": 0.7178948521614075,
      "learning_rate": 3.1183886652757087e-06,
      "loss": 0.1803,
      "mae_dtheta": 0.03049979731440544,
      "mae_dx": 0.009774992242455482,
      "mae_dy": 0.007740726228803396,
      "pose_mae_dtheta": 0.23545140027999878,
      "pose_mae_dx": 0.08245015144348145,
      "pose_mae_dy": 0.09754651039838791,
      "pose_rmse_dtheta": 0.40863385796546936,
      "pose_rmse_dx": 0.15151414275169373,
      "pose_rmse_dy": 0.17799048125743866,
      "pose_rmse_mean": 0.24604617059230804,
      "rmse_dtheta": 0.045828577131032944,
      "rmse_dx": 0.020265007391572,
      "rmse_dy": 0.012117452919483185,
      "rmse_mean": 0.02607034705579281,
      "rotation_flip": 0.018292682245373726,
      "sparse_tokens": 5304.0,
      "step": 7520,
      "turn_loss": 0.2958969175815582,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3494238989035495,
      "grad_norm": 0.559916615486145,
      "learning_rate": 3.1171637098265063e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.00955212488770485,
      "mae_dx": 0.0024188407696783543,
      "mae_dy": 0.002693898044526577,
      "pose_mae_dtheta": 0.06725135445594788,
      "pose_mae_dx": 0.024580584838986397,
      "pose_mae_dy": 0.027264151722192764,
      "pose_rmse_dtheta": 0.15854649245738983,
      "pose_rmse_dx": 0.078483447432518,
      "pose_rmse_dy": 0.06838056445121765,
      "pose_rmse_mean": 0.1018035039305687,
      "rmse_dtheta": 0.021379465237259865,
      "rmse_dx": 0.007860928773880005,
      "rmse_dy": 0.0064588808454573154,
      "rmse_mean": 0.011899758130311966,
      "rotation_flip": 0.008024966344237328,
      "sparse_tokens": 32105.0,
      "step": 7521,
      "turn_loss": 0.09339722990989685,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.3494703586693923,
      "grad_norm": 0.4071171283721924,
      "learning_rate": 3.115938886045058e-06,
      "loss": 0.0887,
      "mae_dtheta": 0.030734119936823845,
      "mae_dx": 0.007926936261355877,
      "mae_dy": 0.003136721672490239,
      "pose_mae_dtheta": 0.22964602708816528,
      "pose_mae_dx": 0.06184575334191322,
      "pose_mae_dy": 0.032614611089229584,
      "pose_rmse_dtheta": 0.40222474932670593,
      "pose_rmse_dx": 0.1357237696647644,
      "pose_rmse_dy": 0.09666699916124344,
      "pose_rmse_mean": 0.21153849363327026,
      "rmse_dtheta": 0.04875665530562401,
      "rmse_dx": 0.018165430054068565,
      "rmse_dy": 0.006716470699757338,
      "rmse_mean": 0.02454618364572525,
      "rotation_flip": 0.01735357940196991,
      "sparse_tokens": 7032.0,
      "step": 7522,
      "turn_loss": 0.21733368933200836,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 29199.0,
      "epoch": 0.3495168184352351,
      "grad_norm": 0.5772321820259094,
      "learning_rate": 3.1147141940170123e-06,
      "loss": 0.1725,
      "mae_dtheta": 0.02967643365263939,
      "mae_dx": 0.00931315217167139,
      "mae_dy": 0.003989043645560741,
      "pose_mae_dtheta": 0.215480774641037,
      "pose_mae_dx": 0.07628366351127625,
      "pose_mae_dy": 0.045905426144599915,
      "pose_rmse_dtheta": 0.3889271020889282,
      "pose_rmse_dx": 0.19783812761306763,
      "pose_rmse_dy": 0.10695362091064453,
      "pose_rmse_mean": 0.23123961687088013,
      "rmse_dtheta": 0.047314323484897614,
      "rmse_dx": 0.02159205451607704,
      "rmse_dy": 0.007906105369329453,
      "rmse_mean": 0.025604164227843285,
      "rotation_flip": 0.013392857275903225,
      "sparse_tokens": 22477.0,
      "step": 7523,
      "turn_loss": 0.23425324261188507,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.34956327820107785,
      "grad_norm": 1.0118255615234375,
      "learning_rate": 3.113489633828016e-06,
      "loss": 0.1679,
      "mae_dtheta": 0.01546353381127119,
      "mae_dx": 0.0026767952367663383,
      "mae_dy": 0.004186579026281834,
      "pose_mae_dtheta": 0.1120852530002594,
      "pose_mae_dx": 0.03691643103957176,
      "pose_mae_dy": 0.0501742959022522,
      "pose_rmse_dtheta": 0.23825792968273163,
      "pose_rmse_dx": 0.08369249850511551,
      "pose_rmse_dy": 0.10846322029829025,
      "pose_rmse_mean": 0.14347122609615326,
      "rmse_dtheta": 0.027657151222229004,
      "rmse_dx": 0.008407875895500183,
      "rmse_dy": 0.008662214502692223,
      "rmse_mean": 0.014909081161022186,
      "rotation_flip": 0.00802964810281992,
      "sparse_tokens": 32121.0,
      "step": 7524,
      "turn_loss": 0.13660500943660736,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.34960973796692063,
      "grad_norm": 0.28654637932777405,
      "learning_rate": 3.1122652055637014e-06,
      "loss": 0.0567,
      "mae_dtheta": 0.008606593124568462,
      "mae_dx": 0.0014489686582237482,
      "mae_dy": 0.0019077359465882182,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.28654640913009644,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 164.56907653808594,
      "model/head/act_norm_mean": 114.5217803030303,
      "model/head/act_norm_min": 81.9231185913086,
      "model/head/act_over_embed": 78.70043959404192,
      "model/head/grad_frac": 0.10664299875497818,
      "model/head/grad_norm": 0.03055816888809204,
      "model/head/grad_zero_frac": 0.00019226668518967927,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6979610558712122,
      "model/head/update_ratio": 0.0005208929069340229,
      "model/head/weight_delta": 9.556607246398926,
      "model/head/weight_delta_rel": 0.1676511913537979,
      "model/head/weight_norm": 58.664974212646484,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42220062017440796,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42212936867793055,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42205387353897095,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2900912541928888,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0974169597029686,
      "model/modality_embedder.encoders.pose/grad_norm": 0.02791447937488556,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5537578466157205,
      "model/modality_embedder.encoders.pose/update_ratio": 0.000901578925549984,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0620086193084717,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10004536807537079,
      "model/modality_embedder.encoders.pose/weight_norm": 30.961769104003906,
      "model/modality_embedder/grad_frac": 0.0974169597029686,
      "model/modality_embedder/grad_norm": 0.02791447937488556,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5537578466157205,
      "model/modality_embedder/update_ratio": 0.000901578925549984,
      "model/modality_embedder/weight_delta": 3.0620086193084717,
      "model/modality_embedder/weight_delta_rel": 0.10004536807537079,
      "model/modality_embedder/weight_norm": 30.961769104003906,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.49836730957031,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.124371192079526,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.05589771270752,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.578493739118567,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08795269578695297,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02520252950489521,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009028228814713657,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5342299938201904,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09234887361526489,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.915252685546875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.07257843017578,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.144004529421196,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.34552001953125,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.279195314497468,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08586978912353516,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.024605680257081985,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.000828587741125375,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2153966426849365,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11138385534286499,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.695926666259766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.91304779052734,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.019267576559244,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.697885513305664,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.56789363697999,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09201331436634064,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.026366084814071655,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008598803542554379,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.4734532833099365,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11663205921649933,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.662504196166992,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.5865249633789,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.768789081289082,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.301252365112305,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.77018119430872,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10510234534740448,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.030116699635982513,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010074441088363528,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.973541021347046,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10162152349948883,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.894163131713867,
      "model/normalizer/grad_frac": 0.40866798162460327,
      "model/normalizer/grad_norm": 0.11710233986377716,
      "model/normalizer/grad_zero_frac": 0.00018907814228441566,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001490341848693788,
      "model/normalizer/weight_delta": 6.280243873596191,
      "model/normalizer/weight_delta_rel": 0.08088590204715729,
      "model/normalizer/weight_norm": 78.57415008544922,
      "pose_mae_dtheta": 0.058516066521406174,
      "pose_mae_dx": 0.015142001211643219,
      "pose_mae_dy": 0.01867304928600788,
      "pose_rmse_dtheta": 0.18147388100624084,
      "pose_rmse_dx": 0.041419487446546555,
      "pose_rmse_dy": 0.05157908424735069,
      "pose_rmse_mean": 0.09149082005023956,
      "rmse_dtheta": 0.021903004497289658,
      "rmse_dx": 0.004279588349163532,
      "rmse_dy": 0.004633998032659292,
      "rmse_mean": 0.010272197425365448,
      "rotation_flip": 0.0010733453091233969,
      "sparse_tokens": 32153.0,
      "step": 7525,
      "turn_loss": 0.05744968727231026,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3496561977327634,
      "grad_norm": 0.3457733988761902,
      "learning_rate": 3.111040909309696e-06,
      "loss": 0.0671,
      "mae_dtheta": 0.008548405021429062,
      "mae_dx": 0.0013808798976242542,
      "mae_dy": 0.000957267009653151,
      "pose_mae_dtheta": 0.06003652140498161,
      "pose_mae_dx": 0.014081382192671299,
      "pose_mae_dy": 0.01640515774488449,
      "pose_rmse_dtheta": 0.19402292370796204,
      "pose_rmse_dx": 0.03228051960468292,
      "pose_rmse_dy": 0.04323127120733261,
      "pose_rmse_mean": 0.08984490483999252,
      "rmse_dtheta": 0.024022463709115982,
      "rmse_dx": 0.004282739944756031,
      "rmse_dy": 0.0020539292600005865,
      "rmse_mean": 0.010119711048901081,
      "rotation_flip": 0.0005144032766111195,
      "sparse_tokens": 32137.0,
      "step": 7526,
      "turn_loss": 0.05355241522192955,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3497026574986062,
      "grad_norm": 0.5981320142745972,
      "learning_rate": 3.1098167451516116e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.010896684601902962,
      "mae_dx": 0.00205321260727942,
      "mae_dy": 0.0025309717748314142,
      "pose_mae_dtheta": 0.07457437366247177,
      "pose_mae_dx": 0.021890461444854736,
      "pose_mae_dy": 0.02329246699810028,
      "pose_rmse_dtheta": 0.19413918256759644,
      "pose_rmse_dx": 0.06690272688865662,
      "pose_rmse_dy": 0.05712316930294037,
      "pose_rmse_mean": 0.10605502128601074,
      "rmse_dtheta": 0.024869654327630997,
      "rmse_dx": 0.006720572244375944,
      "rmse_dy": 0.0057667153887450695,
      "rmse_mean": 0.012452314607799053,
      "rotation_flip": 0.007968127727508545,
      "sparse_tokens": 32089.0,
      "step": 7527,
      "turn_loss": 0.10000456124544144,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.34974911726444896,
      "grad_norm": 0.6508965492248535,
      "learning_rate": 3.1085927131750566e-06,
      "loss": 0.1611,
      "mae_dtheta": 0.013004174456000328,
      "mae_dx": 0.002581427339464426,
      "mae_dy": 0.0035023249220103025,
      "pose_mae_dtheta": 0.09324724972248077,
      "pose_mae_dx": 0.031141847372055054,
      "pose_mae_dy": 0.03517085313796997,
      "pose_rmse_dtheta": 0.2061450183391571,
      "pose_rmse_dx": 0.08312579989433289,
      "pose_rmse_dy": 0.07951167970895767,
      "pose_rmse_mean": 0.12292750179767609,
      "rmse_dtheta": 0.02597746253013611,
      "rmse_dx": 0.0073826247826218605,
      "rmse_dy": 0.007972564548254013,
      "rmse_mean": 0.013777550309896469,
      "rotation_flip": 0.007042253389954567,
      "sparse_tokens": 32137.0,
      "step": 7528,
      "turn_loss": 0.13528791069984436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.3497955770302918,
      "grad_norm": 0.44380807876586914,
      "learning_rate": 3.1073688134656305e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.027912940829992294,
      "mae_dx": 0.008695755153894424,
      "mae_dy": 0.0037397663109004498,
      "pose_mae_dtheta": 0.19008459150791168,
      "pose_mae_dx": 0.06365685909986496,
      "pose_mae_dy": 0.03946971893310547,
      "pose_rmse_dtheta": 0.371150404214859,
      "pose_rmse_dx": 0.17183107137680054,
      "pose_rmse_dy": 0.09075865894556046,
      "pose_rmse_mean": 0.21124672889709473,
      "rmse_dtheta": 0.04623296111822128,
      "rmse_dx": 0.02069879323244095,
      "rmse_dy": 0.008393123745918274,
      "rmse_mean": 0.02510829269886017,
      "rotation_flip": 0.014301430433988571,
      "sparse_tokens": 17459.0,
      "step": 7529,
      "turn_loss": 0.19752000272274017,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.34984203679613457,
      "grad_norm": 0.4104369878768921,
      "learning_rate": 3.106145046108917e-06,
      "loss": 0.1507,
      "mae_dtheta": 0.008876943960785866,
      "mae_dx": 0.0015607422683387995,
      "mae_dy": 0.0019702897407114506,
      "pose_mae_dtheta": 0.05709237605333328,
      "pose_mae_dx": 0.01785721629858017,
      "pose_mae_dy": 0.021500730887055397,
      "pose_rmse_dtheta": 0.1463642120361328,
      "pose_rmse_dx": 0.04582874849438667,
      "pose_rmse_dy": 0.050514619797468185,
      "pose_rmse_mean": 0.08090253174304962,
      "rmse_dtheta": 0.02095765992999077,
      "rmse_dx": 0.004646186716854572,
      "rmse_dy": 0.005034063942730427,
      "rmse_mean": 0.010212636552751064,
      "rotation_flip": 0.0020772747229784727,
      "sparse_tokens": 32105.0,
      "step": 7530,
      "turn_loss": 0.071635901927948,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.34988849656197735,
      "grad_norm": 0.4440842568874359,
      "learning_rate": 3.104921411190499e-06,
      "loss": 0.081,
      "mae_dtheta": 0.007130003534257412,
      "mae_dx": 0.0012483983300626278,
      "mae_dy": 0.0007726562907919288,
      "pose_mae_dtheta": 0.04745056852698326,
      "pose_mae_dx": 0.010711828246712685,
      "pose_mae_dy": 0.011344686150550842,
      "pose_rmse_dtheta": 0.17595799267292023,
      "pose_rmse_dx": 0.025179261341691017,
      "pose_rmse_dy": 0.03052031621336937,
      "pose_rmse_mean": 0.07721919566392899,
      "rmse_dtheta": 0.02195676602423191,
      "rmse_dx": 0.003508075838908553,
      "rmse_dy": 0.0016953740268945694,
      "rmse_mean": 0.009053405374288559,
      "rotation_flip": 0.0,
      "sparse_tokens": 32169.0,
      "step": 7531,
      "turn_loss": 0.04784824326634407,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.3499349563278201,
      "grad_norm": 0.6165449023246765,
      "learning_rate": 3.1036979087959417e-06,
      "loss": 0.1317,
      "mae_dtheta": 0.026245731860399246,
      "mae_dx": 0.006189095322042704,
      "mae_dy": 0.004530940670520067,
      "pose_mae_dtheta": 0.21698981523513794,
      "pose_mae_dx": 0.05588673800230026,
      "pose_mae_dy": 0.06466053426265717,
      "pose_rmse_dtheta": 0.37064582109451294,
      "pose_rmse_dx": 0.1387472301721573,
      "pose_rmse_dy": 0.14075987040996552,
      "pose_rmse_mean": 0.2167176455259323,
      "rmse_dtheta": 0.04193124920129776,
      "rmse_dx": 0.015603430569171906,
      "rmse_dy": 0.009980274364352226,
      "rmse_mean": 0.022504985332489014,
      "rotation_flip": 0.012605042196810246,
      "sparse_tokens": 9826.0,
      "step": 7532,
      "turn_loss": 0.1954679936170578,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.3499814160936629,
      "grad_norm": 0.560221791267395,
      "learning_rate": 3.10247453901081e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.036823101341724396,
      "mae_dx": 0.009670177474617958,
      "mae_dy": 0.005469008814543486,
      "pose_mae_dtheta": 0.2928231656551361,
      "pose_mae_dx": 0.0594647042453289,
      "pose_mae_dy": 0.06374853849411011,
      "pose_rmse_dtheta": 0.580058753490448,
      "pose_rmse_dx": 0.13772033154964447,
      "pose_rmse_dy": 0.1631183624267578,
      "pose_rmse_mean": 0.29363250732421875,
      "rmse_dtheta": 0.05873839184641838,
      "rmse_dx": 0.021019641309976578,
      "rmse_dy": 0.01275116391479969,
      "rmse_mean": 0.030836399644613266,
      "rotation_flip": 0.025925925001502037,
      "sparse_tokens": 9996.0,
      "step": 7533,
      "turn_loss": 0.31294167041778564,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3500278758595057,
      "grad_norm": 0.3907794952392578,
      "learning_rate": 3.101251301920649e-06,
      "loss": 0.089,
      "mae_dtheta": 0.005883899517357349,
      "mae_dx": 0.0011698349844664335,
      "mae_dy": 0.0008295513107441366,
      "pose_mae_dtheta": 0.04001010209321976,
      "pose_mae_dx": 0.010659980587661266,
      "pose_mae_dy": 0.010416210629045963,
      "pose_rmse_dtheta": 0.1631261110305786,
      "pose_rmse_dx": 0.028362007811665535,
      "pose_rmse_dy": 0.02779783122241497,
      "pose_rmse_mean": 0.07309532165527344,
      "rmse_dtheta": 0.02026013471186161,
      "rmse_dx": 0.003400699933990836,
      "rmse_dy": 0.0021071438677608967,
      "rmse_mean": 0.008589326404035091,
      "rotation_flip": 0.0009319664677605033,
      "sparse_tokens": 32169.0,
      "step": 7534,
      "turn_loss": 0.041785817593336105,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.35007433562534845,
      "grad_norm": 0.41020330786705017,
      "learning_rate": 3.100028197611006e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.023522663861513138,
      "mae_dx": 0.012146716937422752,
      "mae_dy": 0.002761104144155979,
      "pose_mae_dtheta": 0.1958225816488266,
      "pose_mae_dx": 0.10576870292425156,
      "pose_mae_dy": 0.03202487900853157,
      "pose_rmse_dtheta": 0.34319111704826355,
      "pose_rmse_dx": 0.24158404767513275,
      "pose_rmse_dy": 0.09176072478294373,
      "pose_rmse_mean": 0.22551195323467255,
      "rmse_dtheta": 0.03880263864994049,
      "rmse_dx": 0.024779101833701134,
      "rmse_dy": 0.005434113088995218,
      "rmse_mean": 0.023005284368991852,
      "rotation_flip": 0.012326656840741634,
      "sparse_tokens": 10859.0,
      "step": 7535,
      "turn_loss": 0.17201462388038635,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.35012079539119123,
      "grad_norm": 0.3968704640865326,
      "learning_rate": 3.09880522616741e-06,
      "loss": 0.0749,
      "mae_dtheta": 0.007551328279078007,
      "mae_dx": 0.0014088769676163793,
      "mae_dy": 0.0013249164912849665,
      "pose_mae_dtheta": 0.050615519285202026,
      "pose_mae_dx": 0.012926070019602776,
      "pose_mae_dy": 0.014216139912605286,
      "pose_rmse_dtheta": 0.16196921467781067,
      "pose_rmse_dx": 0.029528658837080002,
      "pose_rmse_dy": 0.03684225305914879,
      "pose_rmse_mean": 0.07611338049173355,
      "rmse_dtheta": 0.02136514149606228,
      "rmse_dx": 0.003710103454068303,
      "rmse_dy": 0.00363785307854414,
      "rmse_mean": 0.009571033529937267,
      "rotation_flip": 0.005847953259944916,
      "sparse_tokens": 32185.0,
      "step": 7536,
      "turn_loss": 0.05841424688696861,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.350167255157034,
      "grad_norm": 0.4027458727359772,
      "learning_rate": 3.097582387675385e-06,
      "loss": 0.1053,
      "mae_dtheta": 0.00854397565126419,
      "mae_dx": 0.0018194763688370585,
      "mae_dy": 0.002505797892808914,
      "pose_mae_dtheta": 0.059988733381032944,
      "pose_mae_dx": 0.02366791106760502,
      "pose_mae_dy": 0.02491871640086174,
      "pose_rmse_dtheta": 0.14600062370300293,
      "pose_rmse_dx": 0.07011785358190536,
      "pose_rmse_dy": 0.06430335342884064,
      "pose_rmse_mean": 0.09347395598888397,
      "rmse_dtheta": 0.02023502252995968,
      "rmse_dx": 0.005371122620999813,
      "rmse_dy": 0.0066771735437214375,
      "rmse_mean": 0.010761106386780739,
      "rotation_flip": 0.004347825888544321,
      "sparse_tokens": 32073.0,
      "step": 7537,
      "turn_loss": 0.07631810009479523,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3502137149228768,
      "grad_norm": 0.41315704584121704,
      "learning_rate": 3.0963596822204456e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.007773906458169222,
      "mae_dx": 0.0010616593062877655,
      "mae_dy": 0.0019253628561273217,
      "pose_mae_dtheta": 0.04729458689689636,
      "pose_mae_dx": 0.015665462240576744,
      "pose_mae_dy": 0.02183709479868412,
      "pose_rmse_dtheta": 0.09442773461341858,
      "pose_rmse_dx": 0.041463859379291534,
      "pose_rmse_dy": 0.05080441012978554,
      "pose_rmse_mean": 0.06223199889063835,
      "rmse_dtheta": 0.015974901616573334,
      "rmse_dx": 0.002892827382311225,
      "rmse_dy": 0.004321285057812929,
      "rmse_mean": 0.0077296714298427105,
      "rotation_flip": 0.0038038883358240128,
      "sparse_tokens": 32057.0,
      "step": 7538,
      "turn_loss": 0.06177504360675812,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.35026017468871956,
      "grad_norm": 0.6203489303588867,
      "learning_rate": 3.0951371098880946e-06,
      "loss": 0.1574,
      "mae_dtheta": 0.009824653156101704,
      "mae_dx": 0.0015044837491586804,
      "mae_dy": 0.002693470334634185,
      "pose_mae_dtheta": 0.06483826786279678,
      "pose_mae_dx": 0.023151446133852005,
      "pose_mae_dy": 0.03179390728473663,
      "pose_rmse_dtheta": 0.11952096223831177,
      "pose_rmse_dx": 0.056955378502607346,
      "pose_rmse_dy": 0.06801886856555939,
      "pose_rmse_mean": 0.0814984068274498,
      "rmse_dtheta": 0.019178079441189766,
      "rmse_dx": 0.00410738168284297,
      "rmse_dy": 0.005349720362573862,
      "rmse_mean": 0.00954506080597639,
      "rotation_flip": 0.004547044634819031,
      "sparse_tokens": 32121.0,
      "step": 7539,
      "turn_loss": 0.08902527391910553,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.35030663445456234,
      "grad_norm": 0.5218351483345032,
      "learning_rate": 3.093914670763827e-06,
      "loss": 0.1248,
      "mae_dtheta": 0.03709268942475319,
      "mae_dx": 0.012858477421104908,
      "mae_dy": 0.001342565519735217,
      "pose_mae_dtheta": 0.30545878410339355,
      "pose_mae_dx": 0.10322923958301544,
      "pose_mae_dy": 0.015695294365286827,
      "pose_rmse_dtheta": 0.574063777923584,
      "pose_rmse_dx": 0.2656230628490448,
      "pose_rmse_dy": 0.037034276872873306,
      "pose_rmse_mean": 0.2922403812408447,
      "rmse_dtheta": 0.05875633656978607,
      "rmse_dx": 0.026441460475325584,
      "rmse_dy": 0.0026920922100543976,
      "rmse_mean": 0.0292966328561306,
      "rotation_flip": 0.003021148033440113,
      "sparse_tokens": 5622.0,
      "step": 7540,
      "turn_loss": 0.2780417203903198,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3503530942204051,
      "grad_norm": 0.4067656695842743,
      "learning_rate": 3.092692364933132e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.00560156861320138,
      "mae_dx": 0.0009002580191008747,
      "mae_dy": 0.0012722485698759556,
      "pose_mae_dtheta": 0.033920805901288986,
      "pose_mae_dx": 0.012363597750663757,
      "pose_mae_dy": 0.014970105141401291,
      "pose_rmse_dtheta": 0.07390999048948288,
      "pose_rmse_dx": 0.033972010016441345,
      "pose_rmse_dy": 0.04071395471692085,
      "pose_rmse_mean": 0.04953198879957199,
      "rmse_dtheta": 0.012990402057766914,
      "rmse_dx": 0.0025455066934227943,
      "rmse_dy": 0.00293342350050807,
      "rmse_mean": 0.00615644408389926,
      "rotation_flip": 0.001805054140277207,
      "sparse_tokens": 32105.0,
      "step": 7541,
      "turn_loss": 0.047143250703811646,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.3503995539862479,
      "grad_norm": 0.4432739019393921,
      "learning_rate": 3.0914701924814805e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.023903965950012207,
      "mae_dx": 0.011596503667533398,
      "mae_dy": 0.0034232051111757755,
      "pose_mae_dtheta": 0.17984819412231445,
      "pose_mae_dx": 0.09854632616043091,
      "pose_mae_dy": 0.042070407420396805,
      "pose_rmse_dtheta": 0.3608531951904297,
      "pose_rmse_dx": 0.2442701756954193,
      "pose_rmse_dy": 0.09924644976854324,
      "pose_rmse_mean": 0.23478995263576508,
      "rmse_dtheta": 0.041271865367889404,
      "rmse_dx": 0.025055846199393272,
      "rmse_dy": 0.008471251465380192,
      "rmse_mean": 0.024932987987995148,
      "rotation_flip": 0.005305039696395397,
      "sparse_tokens": 17624.0,
      "step": 7542,
      "turn_loss": 0.23073476552963257,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35044601375209067,
      "grad_norm": 0.36487793922424316,
      "learning_rate": 3.0902481534943464e-06,
      "loss": 0.071,
      "mae_dtheta": 0.006143469363451004,
      "mae_dx": 0.0010493327863514423,
      "mae_dy": 0.0010409691603854299,
      "pose_mae_dtheta": 0.04388899356126785,
      "pose_mae_dx": 0.011103890836238861,
      "pose_mae_dy": 0.017567859962582588,
      "pose_rmse_dtheta": 0.11682098358869553,
      "pose_rmse_dx": 0.027809979394078255,
      "pose_rmse_dy": 0.045544516295194626,
      "pose_rmse_mean": 0.06339183449745178,
      "rmse_dtheta": 0.016547387465834618,
      "rmse_dx": 0.0035967249423265457,
      "rmse_dy": 0.0022670163307338953,
      "rmse_mean": 0.007470376323908567,
      "rotation_flip": 0.0016429353272542357,
      "sparse_tokens": 32089.0,
      "step": 7543,
      "turn_loss": 0.051607560366392136,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.35049247351793344,
      "grad_norm": 0.4726381301879883,
      "learning_rate": 3.089026248057181e-06,
      "loss": 0.1259,
      "mae_dtheta": 0.028178296983242035,
      "mae_dx": 0.01266226451843977,
      "mae_dy": 0.003341625677421689,
      "pose_mae_dtheta": 0.2329772710800171,
      "pose_mae_dx": 0.10796607285737991,
      "pose_mae_dy": 0.05669053643941879,
      "pose_rmse_dtheta": 0.41287949681282043,
      "pose_rmse_dx": 0.2406896948814392,
      "pose_rmse_dy": 0.12732800841331482,
      "pose_rmse_mean": 0.26029908657073975,
      "rmse_dtheta": 0.04474171623587608,
      "rmse_dx": 0.025996478274464607,
      "rmse_dy": 0.006436741910874844,
      "rmse_mean": 0.025724980980157852,
      "rotation_flip": 0.010498687624931335,
      "sparse_tokens": 26275.0,
      "step": 7544,
      "turn_loss": 0.20037046074867249,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.3505389332837763,
      "grad_norm": 0.716465950012207,
      "learning_rate": 3.0878044762554376e-06,
      "loss": 0.1722,
      "mae_dtheta": 0.039394959807395935,
      "mae_dx": 0.00790308602154255,
      "mae_dy": 0.0033016393426805735,
      "pose_mae_dtheta": 0.34240061044692993,
      "pose_mae_dx": 0.05537581071257591,
      "pose_mae_dy": 0.0304812453687191,
      "pose_rmse_dtheta": 0.581897497177124,
      "pose_rmse_dx": 0.1455487310886383,
      "pose_rmse_dy": 0.07958926260471344,
      "pose_rmse_mean": 0.26901182532310486,
      "rmse_dtheta": 0.05989549681544304,
      "rmse_dx": 0.0185384601354599,
      "rmse_dy": 0.00970829464495182,
      "rmse_mean": 0.02938075177371502,
      "rotation_flip": 0.011508950963616371,
      "sparse_tokens": 13132.0,
      "step": 7545,
      "turn_loss": 0.2028322070837021,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35058539304961905,
      "grad_norm": 0.46224701404571533,
      "learning_rate": 3.0865828381745515e-06,
      "loss": 0.1214,
      "mae_dtheta": 0.00947684794664383,
      "mae_dx": 0.0022482904605567455,
      "mae_dy": 0.0026314870920032263,
      "pose_mae_dtheta": 0.06639936566352844,
      "pose_mae_dx": 0.0247927475720644,
      "pose_mae_dy": 0.024122849106788635,
      "pose_rmse_dtheta": 0.15627683699131012,
      "pose_rmse_dx": 0.07930127531290054,
      "pose_rmse_dy": 0.0626111775636673,
      "pose_rmse_mean": 0.09939642995595932,
      "rmse_dtheta": 0.02111978456377983,
      "rmse_dx": 0.007124551571905613,
      "rmse_dy": 0.006383649539202452,
      "rmse_mean": 0.011542662046849728,
      "rotation_flip": 0.010411950759589672,
      "sparse_tokens": 32089.0,
      "step": 7546,
      "turn_loss": 0.09068956226110458,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.35063185281546183,
      "grad_norm": 1.0108321905136108,
      "learning_rate": 3.085361333899955e-06,
      "loss": 0.2689,
      "mae_dtheta": 0.04602118954062462,
      "mae_dx": 0.013429088518023491,
      "mae_dy": 0.004519275855273008,
      "pose_mae_dtheta": 0.38227152824401855,
      "pose_mae_dx": 0.10177404433488846,
      "pose_mae_dy": 0.042940929532051086,
      "pose_rmse_dtheta": 0.6210227012634277,
      "pose_rmse_dx": 0.22138820588588715,
      "pose_rmse_dy": 0.09025412797927856,
      "pose_rmse_mean": 0.3108883500099182,
      "rmse_dtheta": 0.063460573554039,
      "rmse_dx": 0.025815442204475403,
      "rmse_dy": 0.007913654670119286,
      "rmse_mean": 0.03239655867218971,
      "rotation_flip": 0.006191950291395187,
      "sparse_tokens": 5508.0,
      "step": 7547,
      "turn_loss": 0.2834690511226654,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 14945.0,
      "epoch": 0.3506783125813046,
      "grad_norm": 0.5002848505973816,
      "learning_rate": 3.08413996351707e-06,
      "loss": 0.1409,
      "mae_dtheta": 0.024954788386821747,
      "mae_dx": 0.009766275063157082,
      "mae_dy": 0.006827583070844412,
      "pose_mae_dtheta": 0.1718132495880127,
      "pose_mae_dx": 0.07033094763755798,
      "pose_mae_dy": 0.07063713669776917,
      "pose_rmse_dtheta": 0.299395889043808,
      "pose_rmse_dx": 0.1791812926530838,
      "pose_rmse_dy": 0.1457573026418686,
      "pose_rmse_mean": 0.20811150968074799,
      "rmse_dtheta": 0.03949001803994179,
      "rmse_dx": 0.02125043049454689,
      "rmse_dy": 0.012954852543771267,
      "rmse_mean": 0.02456510066986084,
      "rotation_flip": 0.014666666276752949,
      "sparse_tokens": 11638.0,
      "step": 7548,
      "turn_loss": 0.24148261547088623,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.3507247723471474,
      "grad_norm": 0.5220838785171509,
      "learning_rate": 3.0829187271113035e-06,
      "loss": 0.0971,
      "mae_dtheta": 0.029287531971931458,
      "mae_dx": 0.008654980920255184,
      "mae_dy": 0.004314263351261616,
      "pose_mae_dtheta": 0.215144544839859,
      "pose_mae_dx": 0.07972319424152374,
      "pose_mae_dy": 0.04909954592585564,
      "pose_rmse_dtheta": 0.3889440596103668,
      "pose_rmse_dx": 0.19127991795539856,
      "pose_rmse_dy": 0.10537941008806229,
      "pose_rmse_mean": 0.22853446006774902,
      "rmse_dtheta": 0.04641518369317055,
      "rmse_dx": 0.02030394971370697,
      "rmse_dy": 0.008237333968281746,
      "rmse_mean": 0.02498548850417137,
      "rotation_flip": 0.016789086163043976,
      "sparse_tokens": 16619.0,
      "step": 7549,
      "turn_loss": 0.23475752770900726,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.35077123211299016,
      "grad_norm": 0.7307479381561279,
      "learning_rate": 3.0816976247680614e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.03290616348385811,
      "mae_dx": 0.011479781940579414,
      "mae_dy": 0.004449542611837387,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7307479977607727,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.7010040283203,
      "model/head/act_norm_mean": 109.61510552300348,
      "model/head/act_norm_min": 75.78299713134766,
      "model/head/act_over_embed": 75.32852674819446,
      "model/head/grad_frac": 0.07965623587369919,
      "model/head/grad_norm": 0.058208636939525604,
      "model/head/grad_zero_frac": 0.00014531047781929374,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.690185546875,
      "model/head/update_ratio": 0.0009921962628141046,
      "model/head/weight_delta": 9.563058853149414,
      "model/head/weight_delta_rel": 0.16776438057422638,
      "model/head/weight_norm": 58.66645431518555,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4221445918083191,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42210256731187973,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42204803228378296,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2900728360432203,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11447955667972565,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0836557075381279,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5533150337837838,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0027019032277166843,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0631134510040283,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10008146613836288,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96177101135254,
      "model/modality_embedder/grad_frac": 0.11447955667972565,
      "model/modality_embedder/grad_norm": 0.0836557075381279,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5533150337837838,
      "model/modality_embedder/update_ratio": 0.0027019032277166843,
      "model/modality_embedder/weight_delta": 3.0631134510040283,
      "model/modality_embedder/weight_delta_rel": 0.10008146613836288,
      "model/modality_embedder/weight_norm": 30.96177101135254,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.64405059814453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.578531470458554,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.07892894744873,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.20338757218865,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.047051262110471725,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.034382615238428116,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012316475622355938,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.537229299545288,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09245816618204117,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.915952682495117,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.72738647460938,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.406522128527335,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.612038612365723,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.772390504184187,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.046040721237659454,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.033644165843725204,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011329057160764933,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.219503402709961,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11152611672878265,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.697235107421875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.88030242919922,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.049944196428573,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.060364723205566,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.90176553520573,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.04890512302517891,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03573732078075409,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011654655681923032,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.4778904914855957,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11678104847669601,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.663557052612305,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.1628189086914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.915414530974427,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.886805534362793,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.183734213914075,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05147978290915489,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03761874884366989,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012583547504618764,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.97800350189209,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10177402943372726,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.895185470581055,
      "model/normalizer/grad_frac": 0.18771187961101532,
      "model/normalizer/grad_norm": 0.13717007637023926,
      "model/normalizer/grad_zero_frac": 0.00022334855748340487,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017457115463912487,
      "model/normalizer/weight_delta": 6.288486003875732,
      "model/normalizer/weight_delta_rel": 0.08099205791950226,
      "model/normalizer/weight_norm": 78.57545471191406,
      "pose_mae_dtheta": 0.2293495386838913,
      "pose_mae_dx": 0.0925808846950531,
      "pose_mae_dy": 0.0690489411354065,
      "pose_rmse_dtheta": 0.39487412571907043,
      "pose_rmse_dx": 0.22285567224025726,
      "pose_rmse_dy": 0.13964331150054932,
      "pose_rmse_mean": 0.25245770812034607,
      "rmse_dtheta": 0.04954013600945473,
      "rmse_dx": 0.024725794792175293,
      "rmse_dy": 0.008160877972841263,
      "rmse_mean": 0.027475601062178612,
      "rotation_flip": 0.009225091896951199,
      "sparse_tokens": 9675.0,
      "step": 7550,
      "turn_loss": 0.20661824941635132,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.35081769187883294,
      "grad_norm": 0.5500765442848206,
      "learning_rate": 3.080476656572732e-06,
      "loss": 0.128,
      "mae_dtheta": 0.00995458010584116,
      "mae_dx": 0.0042333779856562614,
      "mae_dy": 0.00416996655985713,
      "pose_mae_dtheta": 0.06786146014928818,
      "pose_mae_dx": 0.03730955719947815,
      "pose_mae_dy": 0.0402960442006588,
      "pose_rmse_dtheta": 0.2034965455532074,
      "pose_rmse_dx": 0.114028200507164,
      "pose_rmse_dy": 0.14345479011535645,
      "pose_rmse_mean": 0.153659850358963,
      "rmse_dtheta": 0.026382269337773323,
      "rmse_dx": 0.013033656403422356,
      "rmse_dy": 0.012553776614367962,
      "rmse_mean": 0.017323235049843788,
      "rotation_flip": 0.001752848387695849,
      "sparse_tokens": 32121.0,
      "step": 7551,
      "turn_loss": 0.1286582350730896,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3508641516446757,
      "grad_norm": 0.35963907837867737,
      "learning_rate": 3.0792558226107026e-06,
      "loss": 0.0704,
      "mae_dtheta": 0.006567127536982298,
      "mae_dx": 0.0016177636571228504,
      "mae_dy": 0.0004062489897478372,
      "pose_mae_dtheta": 0.04596419632434845,
      "pose_mae_dx": 0.012767739593982697,
      "pose_mae_dy": 0.005228227004408836,
      "pose_rmse_dtheta": 0.20696556568145752,
      "pose_rmse_dx": 0.028946135193109512,
      "pose_rmse_dy": 0.0130614647641778,
      "pose_rmse_mean": 0.08299105614423752,
      "rmse_dtheta": 0.02457772195339203,
      "rmse_dx": 0.004402954131364822,
      "rmse_dy": 0.0009220844367519021,
      "rmse_mean": 0.00996758695691824,
      "rotation_flip": 0.002333722310140729,
      "sparse_tokens": 32201.0,
      "step": 7552,
      "turn_loss": 0.04970130696892738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15591.0,
      "epoch": 0.3509106114105185,
      "grad_norm": 0.6831125617027283,
      "learning_rate": 3.0780351229673423e-06,
      "loss": 0.1505,
      "mae_dtheta": 0.03394317254424095,
      "mae_dx": 0.012164756655693054,
      "mae_dy": 0.006071463692933321,
      "pose_mae_dtheta": 0.2554512917995453,
      "pose_mae_dx": 0.08910790830850601,
      "pose_mae_dy": 0.0825403556227684,
      "pose_rmse_dtheta": 0.429930180311203,
      "pose_rmse_dx": 0.20011812448501587,
      "pose_rmse_dy": 0.18094372749328613,
      "pose_rmse_mean": 0.27033066749572754,
      "rmse_dtheta": 0.04987579956650734,
      "rmse_dx": 0.02479998767375946,
      "rmse_dy": 0.01165952067822218,
      "rmse_mean": 0.028778433799743652,
      "rotation_flip": 0.022191401571035385,
      "sparse_tokens": 12034.0,
      "step": 7553,
      "turn_loss": 0.31025660037994385,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.35095707117636127,
      "grad_norm": 0.5604284405708313,
      "learning_rate": 3.0768145577280177e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.03335513919591904,
      "mae_dx": 0.016557954251766205,
      "mae_dy": 0.004276223946362734,
      "pose_mae_dtheta": 0.2945261299610138,
      "pose_mae_dx": 0.12667717039585114,
      "pose_mae_dy": 0.06644034385681152,
      "pose_rmse_dtheta": 0.5116502046585083,
      "pose_rmse_dx": 0.2780720293521881,
      "pose_rmse_dy": 0.1397554874420166,
      "pose_rmse_mean": 0.3098258972167969,
      "rmse_dtheta": 0.05219874531030655,
      "rmse_dx": 0.030519863590598106,
      "rmse_dy": 0.007834947668015957,
      "rmse_mean": 0.030184520408511162,
      "rotation_flip": 0.010380622930824757,
      "sparse_tokens": 5984.0,
      "step": 7554,
      "turn_loss": 0.28077200055122375,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.35100353094220405,
      "grad_norm": 0.4730691909790039,
      "learning_rate": 3.075594126978084e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.007924084551632404,
      "mae_dx": 0.0037815882824361324,
      "mae_dy": 0.0016809331718832254,
      "pose_mae_dtheta": 0.05646762251853943,
      "pose_mae_dx": 0.03651067987084389,
      "pose_mae_dy": 0.02008228376507759,
      "pose_rmse_dtheta": 0.1635242998600006,
      "pose_rmse_dx": 0.11653680354356766,
      "pose_rmse_dy": 0.05174645781517029,
      "pose_rmse_mean": 0.11060252040624619,
      "rmse_dtheta": 0.021953636780381203,
      "rmse_dx": 0.012232819572091103,
      "rmse_dy": 0.004410080146044493,
      "rmse_mean": 0.012865512631833553,
      "rotation_flip": 0.004608294926583767,
      "sparse_tokens": 32105.0,
      "step": 7555,
      "turn_loss": 0.11558147519826889,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3510499907080468,
      "grad_norm": 0.44559502601623535,
      "learning_rate": 3.074373830802886e-06,
      "loss": 0.0868,
      "mae_dtheta": 0.008394085802137852,
      "mae_dx": 0.002355191856622696,
      "mae_dy": 0.002537724794819951,
      "pose_mae_dtheta": 0.06171397492289543,
      "pose_mae_dx": 0.020171796903014183,
      "pose_mae_dy": 0.021106578409671783,
      "pose_rmse_dtheta": 0.18418940901756287,
      "pose_rmse_dx": 0.06748441606760025,
      "pose_rmse_dy": 0.0512637123465538,
      "pose_rmse_mean": 0.10097917914390564,
      "rmse_dtheta": 0.022452527657151222,
      "rmse_dx": 0.0080569451674819,
      "rmse_dy": 0.008177066221833229,
      "rmse_mean": 0.012895512394607067,
      "rotation_flip": 0.004736530594527721,
      "sparse_tokens": 32073.0,
      "step": 7556,
      "turn_loss": 0.08201248198747635,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.3510964504738896,
      "grad_norm": 0.5182820558547974,
      "learning_rate": 3.0731536692877596e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.028981797397136688,
      "mae_dx": 0.00996079109609127,
      "mae_dy": 0.0050154924392700195,
      "pose_mae_dtheta": 0.20510217547416687,
      "pose_mae_dx": 0.08399870246648788,
      "pose_mae_dy": 0.06453050673007965,
      "pose_rmse_dtheta": 0.41072601079940796,
      "pose_rmse_dx": 0.22013947367668152,
      "pose_rmse_dy": 0.14960119128227234,
      "pose_rmse_mean": 0.2601555585861206,
      "rmse_dtheta": 0.049274176359176636,
      "rmse_dx": 0.023554356768727303,
      "rmse_dy": 0.012484907172620296,
      "rmse_mean": 0.028437813743948936,
      "rotation_flip": 0.013024602085351944,
      "sparse_tokens": 12149.0,
      "step": 7557,
      "turn_loss": 0.25011396408081055,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.3511429102397324,
      "grad_norm": 0.8027446866035461,
      "learning_rate": 3.0719336425180306e-06,
      "loss": 0.2538,
      "mae_dtheta": 0.038268763571977615,
      "mae_dx": 0.008764824829995632,
      "mae_dy": 0.0032031566370278597,
      "pose_mae_dtheta": 0.2970702350139618,
      "pose_mae_dx": 0.07285605370998383,
      "pose_mae_dy": 0.03163990378379822,
      "pose_rmse_dtheta": 0.5062893033027649,
      "pose_rmse_dx": 0.17410831153392792,
      "pose_rmse_dy": 0.078455850481987,
      "pose_rmse_mean": 0.25295117497444153,
      "rmse_dtheta": 0.055945441126823425,
      "rmse_dx": 0.019524790346622467,
      "rmse_dy": 0.006967946887016296,
      "rmse_mean": 0.027479393407702446,
      "rotation_flip": 0.01129568088799715,
      "sparse_tokens": 24426.0,
      "step": 7558,
      "turn_loss": 0.27763688564300537,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.35118937000557515,
      "grad_norm": 0.6028946042060852,
      "learning_rate": 3.0707137505790163e-06,
      "loss": 0.1326,
      "mae_dtheta": 0.03407272323966026,
      "mae_dx": 0.010861329734325409,
      "mae_dy": 0.005041713826358318,
      "pose_mae_dtheta": 0.27014631032943726,
      "pose_mae_dx": 0.0880909115076065,
      "pose_mae_dy": 0.049073249101638794,
      "pose_rmse_dtheta": 0.4820805490016937,
      "pose_rmse_dx": 0.2135109007358551,
      "pose_rmse_dy": 0.11252939701080322,
      "pose_rmse_mean": 0.2693736255168915,
      "rmse_dtheta": 0.053370825946331024,
      "rmse_dx": 0.022723529487848282,
      "rmse_dy": 0.010336408391594887,
      "rmse_mean": 0.028810255229473114,
      "rotation_flip": 0.02465331368148327,
      "sparse_tokens": 22214.0,
      "step": 7559,
      "turn_loss": 0.23587968945503235,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.35123582977141793,
      "grad_norm": 0.6775403022766113,
      "learning_rate": 3.0694939935560277e-06,
      "loss": 0.1747,
      "mae_dtheta": 0.04056747257709503,
      "mae_dx": 0.013269955292344093,
      "mae_dy": 0.006488565355539322,
      "pose_mae_dtheta": 0.3478558361530304,
      "pose_mae_dx": 0.1050151064991951,
      "pose_mae_dy": 0.0726252943277359,
      "pose_rmse_dtheta": 0.5714804530143738,
      "pose_rmse_dx": 0.22732532024383545,
      "pose_rmse_dy": 0.18156251311302185,
      "pose_rmse_mean": 0.3267894387245178,
      "rmse_dtheta": 0.05995326489210129,
      "rmse_dx": 0.026056881994009018,
      "rmse_dy": 0.014553497545421124,
      "rmse_mean": 0.03352121263742447,
      "rotation_flip": 0.016842104494571686,
      "sparse_tokens": 6940.0,
      "step": 7560,
      "turn_loss": 0.33111727237701416,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3512822895372607,
      "grad_norm": 0.6693882942199707,
      "learning_rate": 3.0682743715343565e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.012297481298446655,
      "mae_dx": 0.001463083433918655,
      "mae_dy": 0.0032219216227531433,
      "pose_mae_dtheta": 0.07807528227567673,
      "pose_mae_dx": 0.021436793729662895,
      "pose_mae_dy": 0.03182028606534004,
      "pose_rmse_dtheta": 0.1898217648267746,
      "pose_rmse_dx": 0.04884455353021622,
      "pose_rmse_dy": 0.06866690516471863,
      "pose_rmse_mean": 0.10244441032409668,
      "rmse_dtheta": 0.025049904361367226,
      "rmse_dx": 0.004119952209293842,
      "rmse_dy": 0.006731047295033932,
      "rmse_mean": 0.011966968886554241,
      "rotation_flip": 0.006981383077800274,
      "sparse_tokens": 32073.0,
      "step": 7561,
      "turn_loss": 0.11112377792596817,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.35132874930310354,
      "grad_norm": 0.3351835608482361,
      "learning_rate": 3.0670548845992987e-06,
      "loss": 0.0652,
      "mae_dtheta": 0.0073896246030926704,
      "mae_dx": 0.0010441187769174576,
      "mae_dy": 0.0013197676744312048,
      "pose_mae_dtheta": 0.04474090412259102,
      "pose_mae_dx": 0.01512464415282011,
      "pose_mae_dy": 0.018696164712309837,
      "pose_rmse_dtheta": 0.1344066560268402,
      "pose_rmse_dx": 0.037552423775196075,
      "pose_rmse_dy": 0.04860769957304001,
      "pose_rmse_mean": 0.07352226227521896,
      "rmse_dtheta": 0.01850256882607937,
      "rmse_dx": 0.0033345664851367474,
      "rmse_dy": 0.002956513548269868,
      "rmse_mean": 0.008264550007879734,
      "rotation_flip": 0.002210433129221201,
      "sparse_tokens": 32105.0,
      "step": 7562,
      "turn_loss": 0.05206938460469246,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29755.0,
      "epoch": 0.3513752090689463,
      "grad_norm": 0.5089412331581116,
      "learning_rate": 3.065835532836128e-06,
      "loss": 0.1729,
      "mae_dtheta": 0.03170139342546463,
      "mae_dx": 0.013946852646768093,
      "mae_dy": 0.004760602954775095,
      "pose_mae_dtheta": 0.24362245202064514,
      "pose_mae_dx": 0.11540492624044418,
      "pose_mae_dy": 0.054669853299856186,
      "pose_rmse_dtheta": 0.42981258034706116,
      "pose_rmse_dx": 0.26133063435554504,
      "pose_rmse_dy": 0.1223691925406456,
      "pose_rmse_mean": 0.27117079496383667,
      "rmse_dtheta": 0.04818537086248398,
      "rmse_dx": 0.027950599789619446,
      "rmse_dy": 0.009149129502475262,
      "rmse_mean": 0.028428366407752037,
      "rotation_flip": 0.013432836160063744,
      "sparse_tokens": 22051.0,
      "step": 7563,
      "turn_loss": 0.26737627387046814,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3514216688347891,
      "grad_norm": 0.48077481985092163,
      "learning_rate": 3.064616316330119e-06,
      "loss": 0.0869,
      "mae_dtheta": 0.013316519558429718,
      "mae_dx": 0.003669415833428502,
      "mae_dy": 0.005151948891580105,
      "pose_mae_dtheta": 0.09334690868854523,
      "pose_mae_dx": 0.03732297569513321,
      "pose_mae_dy": 0.03417753428220749,
      "pose_rmse_dtheta": 0.23337911069393158,
      "pose_rmse_dx": 0.10906261205673218,
      "pose_rmse_dy": 0.08573663979768753,
      "pose_rmse_mean": 0.1427261233329773,
      "rmse_dtheta": 0.02878309041261673,
      "rmse_dx": 0.009211063385009766,
      "rmse_dy": 0.012204980477690697,
      "rmse_mean": 0.016733046621084213,
      "rotation_flip": 0.007692307699471712,
      "sparse_tokens": 32137.0,
      "step": 7564,
      "turn_loss": 0.1410517394542694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.35146812860063187,
      "grad_norm": 0.5348480939865112,
      "learning_rate": 3.063397235166527e-06,
      "loss": 0.1423,
      "mae_dtheta": 0.009641382843255997,
      "mae_dx": 0.001798061071895063,
      "mae_dy": 0.0024511790834367275,
      "pose_mae_dtheta": 0.06425243616104126,
      "pose_mae_dx": 0.025858601555228233,
      "pose_mae_dy": 0.025650762021541595,
      "pose_rmse_dtheta": 0.1520068645477295,
      "pose_rmse_dx": 0.06473822891712189,
      "pose_rmse_dy": 0.05863843485713005,
      "pose_rmse_mean": 0.09179451316595078,
      "rmse_dtheta": 0.02142726071178913,
      "rmse_dx": 0.0045404438860714436,
      "rmse_dy": 0.005436058156192303,
      "rmse_mean": 0.010467920452356339,
      "rotation_flip": 0.0017992083448916674,
      "sparse_tokens": 32169.0,
      "step": 7565,
      "turn_loss": 0.09081210196018219,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.35151458836647465,
      "grad_norm": 0.4331667125225067,
      "learning_rate": 3.062178289430606e-06,
      "loss": 0.1062,
      "mae_dtheta": 0.008934006094932556,
      "mae_dx": 0.0017124275909736753,
      "mae_dy": 0.002645815024152398,
      "pose_mae_dtheta": 0.05821242928504944,
      "pose_mae_dx": 0.02632461115717888,
      "pose_mae_dy": 0.027726707980036736,
      "pose_rmse_dtheta": 0.1357424110174179,
      "pose_rmse_dx": 0.0699244886636734,
      "pose_rmse_dy": 0.0672546923160553,
      "pose_rmse_mean": 0.0909738689661026,
      "rmse_dtheta": 0.01929965242743492,
      "rmse_dx": 0.004730536136776209,
      "rmse_dy": 0.006117088254541159,
      "rmse_mean": 0.010049092583358288,
      "rotation_flip": 0.0014689679956063628,
      "sparse_tokens": 32105.0,
      "step": 7566,
      "turn_loss": 0.07333739846944809,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.3515610481323174,
      "grad_norm": 0.580757737159729,
      "learning_rate": 3.0609594792076e-06,
      "loss": 0.185,
      "mae_dtheta": 0.01831071637570858,
      "mae_dx": 0.006635989528149366,
      "mae_dy": 0.003036222653463483,
      "pose_mae_dtheta": 0.15688395500183105,
      "pose_mae_dx": 0.06150854006409645,
      "pose_mae_dy": 0.031237201765179634,
      "pose_rmse_dtheta": 0.2920105457305908,
      "pose_rmse_dx": 0.12620975077152252,
      "pose_rmse_dy": 0.0692642405629158,
      "pose_rmse_mean": 0.16249483823776245,
      "rmse_dtheta": 0.031243570148944855,
      "rmse_dx": 0.014396428130567074,
      "rmse_dy": 0.005691670812666416,
      "rmse_mean": 0.017110556364059448,
      "rotation_flip": 0.0,
      "sparse_tokens": 5384.0,
      "step": 7567,
      "turn_loss": 0.18697567284107208,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3516075078981602,
      "grad_norm": 0.49049052596092224,
      "learning_rate": 3.059740804582736e-06,
      "loss": 0.1229,
      "mae_dtheta": 0.008505309000611305,
      "mae_dx": 0.0018207710236310959,
      "mae_dy": 0.0024634660221636295,
      "pose_mae_dtheta": 0.059566207230091095,
      "pose_mae_dx": 0.02353079803287983,
      "pose_mae_dy": 0.027685340493917465,
      "pose_rmse_dtheta": 0.11930907517671585,
      "pose_rmse_dx": 0.060346122831106186,
      "pose_rmse_dy": 0.06249956041574478,
      "pose_rmse_mean": 0.08071824908256531,
      "rmse_dtheta": 0.017038894817233086,
      "rmse_dx": 0.005304573103785515,
      "rmse_dy": 0.005420169793069363,
      "rmse_mean": 0.009254546836018562,
      "rotation_flip": 0.0014809330459684134,
      "sparse_tokens": 32105.0,
      "step": 7568,
      "turn_loss": 0.0771690234541893,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.351653967664003,
      "grad_norm": 0.45088818669319153,
      "learning_rate": 3.0585222656412406e-06,
      "loss": 0.1102,
      "mae_dtheta": 0.032269347459077835,
      "mae_dx": 0.0113803306594491,
      "mae_dy": 0.005986793898046017,
      "pose_mae_dtheta": 0.2423858791589737,
      "pose_mae_dx": 0.08768319338560104,
      "pose_mae_dy": 0.06812749058008194,
      "pose_rmse_dtheta": 0.41761910915374756,
      "pose_rmse_dx": 0.18241393566131592,
      "pose_rmse_dy": 0.1698554903268814,
      "pose_rmse_mean": 0.2566295266151428,
      "rmse_dtheta": 0.051055628806352615,
      "rmse_dx": 0.022058682516217232,
      "rmse_dy": 0.013491017743945122,
      "rmse_mean": 0.02886844426393509,
      "rotation_flip": 0.012249442748725414,
      "sparse_tokens": 16548.0,
      "step": 7569,
      "turn_loss": 0.26778531074523926,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.35170042742984575,
      "grad_norm": 0.515061616897583,
      "learning_rate": 3.0573038624683234e-06,
      "loss": 0.117,
      "mae_dtheta": 0.007383088115602732,
      "mae_dx": 0.0010720802238211036,
      "mae_dy": 0.001620419672690332,
      "pose_mae_dtheta": 0.049066558480262756,
      "pose_mae_dx": 0.013473128899931908,
      "pose_mae_dy": 0.02306911163032055,
      "pose_rmse_dtheta": 0.11583425849676132,
      "pose_rmse_dx": 0.036001432687044144,
      "pose_rmse_dy": 0.0550859309732914,
      "pose_rmse_mean": 0.06897387653589249,
      "rmse_dtheta": 0.0163592416793108,
      "rmse_dx": 0.003776394994929433,
      "rmse_dy": 0.003284235717728734,
      "rmse_mean": 0.007806624751538038,
      "rotation_flip": 0.0012371133780106902,
      "sparse_tokens": 32073.0,
      "step": 7570,
      "turn_loss": 0.06229649484157562,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.35174688719568853,
      "grad_norm": 0.5780673623085022,
      "learning_rate": 3.056085595149192e-06,
      "loss": 0.1341,
      "mae_dtheta": 0.014101026579737663,
      "mae_dx": 0.0030626263469457626,
      "mae_dy": 0.004398280754685402,
      "pose_mae_dtheta": 0.10187580436468124,
      "pose_mae_dx": 0.034949544817209244,
      "pose_mae_dy": 0.037513718008995056,
      "pose_rmse_dtheta": 0.22933785617351532,
      "pose_rmse_dx": 0.08991795778274536,
      "pose_rmse_dy": 0.08836106210947037,
      "pose_rmse_mean": 0.13587230443954468,
      "rmse_dtheta": 0.027168966829776764,
      "rmse_dx": 0.008067379705607891,
      "rmse_dy": 0.008885395713150501,
      "rmse_mean": 0.014707247726619244,
      "rotation_flip": 0.0053644683212041855,
      "sparse_tokens": 32137.0,
      "step": 7571,
      "turn_loss": 0.1319563388824463,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2635.0,
      "epoch": 0.3517933469615313,
      "grad_norm": 0.654431939125061,
      "learning_rate": 3.0548674637690356e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.04927575960755348,
      "mae_dx": 0.04639106243848801,
      "mae_dy": 0.02014823630452156,
      "pose_mae_dtheta": 0.4010959565639496,
      "pose_mae_dx": 0.3621213734149933,
      "pose_mae_dy": 0.29224562644958496,
      "pose_rmse_dtheta": 0.5372377038002014,
      "pose_rmse_dx": 0.5236186385154724,
      "pose_rmse_dy": 0.44014468789100647,
      "pose_rmse_mean": 0.5003336668014526,
      "rmse_dtheta": 0.06299516558647156,
      "rmse_dx": 0.05625748634338379,
      "rmse_dy": 0.030256474390625954,
      "rmse_mean": 0.049836378544569016,
      "rotation_flip": 0.02083333395421505,
      "sparse_tokens": 2105.0,
      "step": 7572,
      "turn_loss": 0.5562400221824646,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.3518398067273741,
      "grad_norm": 0.43935132026672363,
      "learning_rate": 3.053649468413043e-06,
      "loss": 0.108,
      "mae_dtheta": 0.034902576357126236,
      "mae_dx": 0.010101129300892353,
      "mae_dy": 0.002814213978126645,
      "pose_mae_dtheta": 0.2931755483150482,
      "pose_mae_dx": 0.07442037761211395,
      "pose_mae_dy": 0.028681792318820953,
      "pose_rmse_dtheta": 0.5419078469276428,
      "pose_rmse_dx": 0.16109512746334076,
      "pose_rmse_dy": 0.06888940930366516,
      "pose_rmse_mean": 0.25729748606681824,
      "rmse_dtheta": 0.05382721871137619,
      "rmse_dx": 0.02022530324757099,
      "rmse_dy": 0.0064458162523806095,
      "rmse_mean": 0.026832779869437218,
      "rotation_flip": 0.017921147868037224,
      "sparse_tokens": 9156.0,
      "step": 7573,
      "turn_loss": 0.22134873270988464,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.35188626649321686,
      "grad_norm": 0.6214815974235535,
      "learning_rate": 3.0524316091663873e-06,
      "loss": 0.1528,
      "mae_dtheta": 0.03487173840403557,
      "mae_dx": 0.013342481106519699,
      "mae_dy": 0.0037842635065317154,
      "pose_mae_dtheta": 0.2517719864845276,
      "pose_mae_dx": 0.11420239508152008,
      "pose_mae_dy": 0.046160753816366196,
      "pose_rmse_dtheta": 0.4659782350063324,
      "pose_rmse_dx": 0.24793963134288788,
      "pose_rmse_dy": 0.11349451541900635,
      "pose_rmse_mean": 0.2758041322231293,
      "rmse_dtheta": 0.05453287810087204,
      "rmse_dx": 0.02598784677684307,
      "rmse_dy": 0.007342973258346319,
      "rmse_mean": 0.029287900775671005,
      "rotation_flip": 0.009486165829002857,
      "sparse_tokens": 22436.0,
      "step": 7574,
      "turn_loss": 0.28967154026031494,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.35193272625905964,
      "grad_norm": 0.7950578331947327,
      "learning_rate": 3.0512138861142354e-06,
      "loss": 0.2007,
      "mae_dtheta": 0.03374480828642845,
      "mae_dx": 0.013563982211053371,
      "mae_dy": 0.006274459417909384,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7950576543807983,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 133.672119140625,
      "model/head/act_norm_mean": 101.65272983284883,
      "model/head/act_norm_min": 60.85539627075195,
      "model/head/act_over_embed": 69.8567076289845,
      "model/head/grad_frac": 0.08631034940481186,
      "model/head/grad_norm": 0.06862170249223709,
      "model/head/grad_zero_frac": 0.00021606207883451134,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6971747819767442,
      "model/head/update_ratio": 0.0011696603614836931,
      "model/head/weight_delta": 9.571247100830078,
      "model/head/weight_delta_rel": 0.16790802776813507,
      "model/head/weight_norm": 58.66805648803711,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42217954993247986,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42217954993247986,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42217954993247986,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901257392208194,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11023147404193878,
      "model/modality_embedder.encoders.pose/grad_norm": 0.08764037489891052,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0028306052554398775,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0646796226501465,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10013263672590256,
      "model/modality_embedder.encoders.pose/weight_norm": 30.961708068847656,
      "model/modality_embedder/grad_frac": 0.11023147404193878,
      "model/modality_embedder/grad_norm": 0.08764037489891052,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544921875,
      "model/modality_embedder/update_ratio": 0.0028306052554398775,
      "model/modality_embedder/weight_delta": 3.0646796226501465,
      "model/modality_embedder/weight_delta_rel": 0.10013263672590256,
      "model/modality_embedder/weight_norm": 30.961708068847656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.0634765625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.83062246216316,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.294078826904297,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.6894174996536,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.052169665694236755,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04147789254784584,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00035305035999044776,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014857820933684707,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.540602445602417,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09258108586072922,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.91653823852539,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.55342864990234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.634078534514583,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.416081428527832,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.241560034647758,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06127149611711502,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.048714373260736465,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016402885084971786,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2237260341644287,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11167238652706146,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.69866180419922,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 76.51860809326172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.199597983573273,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.758935928344727,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.317399656664893,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.062168847769498825,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0494278185069561,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002975710085593164,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016118561616167426,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.4825000762939453,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1169358342885971,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.6651554107666,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 77.27392578125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.100991486710964,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.319446563720703,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.624055073147552,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.058407433331012726,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.046437278389930725,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015532991383224726,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.9821510314941406,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10191576927900314,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.89590072631836,
      "model/normalizer/grad_frac": 0.20800821483135223,
      "model/normalizer/grad_norm": 0.16537852585315704,
      "model/normalizer/grad_zero_frac": 0.00028598069911822677,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002104672370478511,
      "model/normalizer/weight_delta": 6.296900272369385,
      "model/normalizer/weight_delta_rel": 0.08110042661428452,
      "model/normalizer/weight_norm": 78.57685089111328,
      "pose_mae_dtheta": 0.2564670741558075,
      "pose_mae_dx": 0.09583428502082825,
      "pose_mae_dy": 0.0725875124335289,
      "pose_rmse_dtheta": 0.398385226726532,
      "pose_rmse_dx": 0.2245887964963913,
      "pose_rmse_dy": 0.15535672008991241,
      "pose_rmse_mean": 0.25944358110427856,
      "rmse_dtheta": 0.04782722890377045,
      "rmse_dx": 0.026506323367357254,
      "rmse_dy": 0.01157075073570013,
      "rmse_mean": 0.02863476797938347,
      "rotation_flip": 0.014184396713972092,
      "sparse_tokens": 12037.0,
      "step": 7575,
      "turn_loss": 0.3486865758895874,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3519791860249024,
      "grad_norm": 0.5127617716789246,
      "learning_rate": 3.049996299341742e-06,
      "loss": 0.1219,
      "mae_dtheta": 0.013916119001805782,
      "mae_dx": 0.003094487590715289,
      "mae_dy": 0.003724866546690464,
      "pose_mae_dtheta": 0.09441051632165909,
      "pose_mae_dx": 0.03858088701963425,
      "pose_mae_dy": 0.037349507212638855,
      "pose_rmse_dtheta": 0.20556513965129852,
      "pose_rmse_dx": 0.09669752418994904,
      "pose_rmse_dy": 0.08681794255971909,
      "pose_rmse_mean": 0.12969353795051575,
      "rmse_dtheta": 0.027189768850803375,
      "rmse_dx": 0.008628029376268387,
      "rmse_dy": 0.00799973402172327,
      "rmse_mean": 0.014605844393372536,
      "rotation_flip": 0.0070945946499705315,
      "sparse_tokens": 32121.0,
      "step": 7576,
      "turn_loss": 0.1260184347629547,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3520256457907452,
      "grad_norm": 0.7082927823066711,
      "learning_rate": 3.048778848934054e-06,
      "loss": 0.1338,
      "mae_dtheta": 0.010874751023948193,
      "mae_dx": 0.0028740258421748877,
      "mae_dy": 0.004235032945871353,
      "pose_mae_dtheta": 0.08261232078075409,
      "pose_mae_dx": 0.04210206866264343,
      "pose_mae_dy": 0.04083644226193428,
      "pose_rmse_dtheta": 0.21576985716819763,
      "pose_rmse_dx": 0.11606664210557938,
      "pose_rmse_dy": 0.10226580500602722,
      "pose_rmse_mean": 0.1447007656097412,
      "rmse_dtheta": 0.025517361238598824,
      "rmse_dx": 0.007929586805403233,
      "rmse_dy": 0.010210557840764523,
      "rmse_mean": 0.014552502892911434,
      "rotation_flip": 0.004421222023665905,
      "sparse_tokens": 32121.0,
      "step": 7577,
      "turn_loss": 0.1088595911860466,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.352072105556588,
      "grad_norm": 0.6609578132629395,
      "learning_rate": 3.047561534976307e-06,
      "loss": 0.071,
      "mae_dtheta": 0.008038880303502083,
      "mae_dx": 0.00161988555919379,
      "mae_dy": 0.0016109799034893513,
      "pose_mae_dtheta": 0.05212608352303505,
      "pose_mae_dx": 0.0169389508664608,
      "pose_mae_dy": 0.018172170966863632,
      "pose_rmse_dtheta": 0.15695491433143616,
      "pose_rmse_dx": 0.04786870628595352,
      "pose_rmse_dy": 0.05245614051818848,
      "pose_rmse_mean": 0.08575992286205292,
      "rmse_dtheta": 0.022259052842855453,
      "rmse_dx": 0.005290967877954245,
      "rmse_dy": 0.004632747266441584,
      "rmse_mean": 0.010727589949965477,
      "rotation_flip": 0.0038910505827516317,
      "sparse_tokens": 32105.0,
      "step": 7578,
      "turn_loss": 0.07215490937232971,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3521185653224308,
      "grad_norm": 0.5386415719985962,
      "learning_rate": 3.0463443575536324e-06,
      "loss": 0.1107,
      "mae_dtheta": 0.012977314181625843,
      "mae_dx": 0.0019251549383625388,
      "mae_dy": 0.00289455009624362,
      "pose_mae_dtheta": 0.08153630048036575,
      "pose_mae_dx": 0.025473514571785927,
      "pose_mae_dy": 0.037165459245443344,
      "pose_rmse_dtheta": 0.15370167791843414,
      "pose_rmse_dx": 0.05846215784549713,
      "pose_rmse_dy": 0.07171085476875305,
      "pose_rmse_mean": 0.09462489932775497,
      "rmse_dtheta": 0.022126920521259308,
      "rmse_dx": 0.005965442396700382,
      "rmse_dy": 0.005012276582419872,
      "rmse_mean": 0.011034879833459854,
      "rotation_flip": 0.008285531774163246,
      "sparse_tokens": 32105.0,
      "step": 7579,
      "turn_loss": 0.10859403014183044,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.3521650250882736,
      "grad_norm": 0.8954160809516907,
      "learning_rate": 3.045127316751143e-06,
      "loss": 0.1829,
      "mae_dtheta": 0.03500751778483391,
      "mae_dx": 0.013848038390278816,
      "mae_dy": 0.00557061517611146,
      "pose_mae_dtheta": 0.28614357113838196,
      "pose_mae_dx": 0.10812313854694366,
      "pose_mae_dy": 0.07512523978948593,
      "pose_rmse_dtheta": 0.4891760051250458,
      "pose_rmse_dx": 0.22332201898097992,
      "pose_rmse_dy": 0.1581752747297287,
      "pose_rmse_mean": 0.29022443294525146,
      "rmse_dtheta": 0.05257028713822365,
      "rmse_dx": 0.026325955986976624,
      "rmse_dy": 0.01121873501688242,
      "rmse_mean": 0.030038325116038322,
      "rotation_flip": 0.019909502938389778,
      "sparse_tokens": 19957.0,
      "step": 7580,
      "turn_loss": 0.2859323024749756,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.35221148485411635,
      "grad_norm": 0.6963221430778503,
      "learning_rate": 3.043910412653952e-06,
      "loss": 0.1762,
      "mae_dtheta": 0.04193979501724243,
      "mae_dx": 0.02071111649274826,
      "mae_dy": 0.005901012569665909,
      "pose_mae_dtheta": 0.35181334614753723,
      "pose_mae_dx": 0.16772401332855225,
      "pose_mae_dy": 0.07221025973558426,
      "pose_rmse_dtheta": 0.5512650012969971,
      "pose_rmse_dx": 0.3289202153682709,
      "pose_rmse_dy": 0.14640812575817108,
      "pose_rmse_mean": 0.3421977758407593,
      "rmse_dtheta": 0.05723688378930092,
      "rmse_dx": 0.03487761318683624,
      "rmse_dy": 0.00977746769785881,
      "rmse_mean": 0.03396398946642876,
      "rotation_flip": 0.011627906933426857,
      "sparse_tokens": 10764.0,
      "step": 7581,
      "turn_loss": 0.37320101261138916,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.35225794461995913,
      "grad_norm": 0.5663283467292786,
      "learning_rate": 3.0426936453471533e-06,
      "loss": 0.1385,
      "mae_dtheta": 0.0329323336482048,
      "mae_dx": 0.009350637905299664,
      "mae_dy": 0.005055662710219622,
      "pose_mae_dtheta": 0.27687880396842957,
      "pose_mae_dx": 0.0832689180970192,
      "pose_mae_dy": 0.07807178050279617,
      "pose_rmse_dtheta": 0.5002948045730591,
      "pose_rmse_dx": 0.1931094527244568,
      "pose_rmse_dy": 0.16483917832374573,
      "pose_rmse_mean": 0.2860811650753021,
      "rmse_dtheta": 0.05084516108036041,
      "rmse_dx": 0.020193401724100113,
      "rmse_dy": 0.009774717502295971,
      "rmse_mean": 0.026937758550047874,
      "rotation_flip": 0.016483517363667488,
      "sparse_tokens": 8426.0,
      "step": 7582,
      "turn_loss": 0.2646957337856293,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3523044043858019,
      "grad_norm": 0.5729504227638245,
      "learning_rate": 3.041477014915841e-06,
      "loss": 0.1575,
      "mae_dtheta": 0.006883223541080952,
      "mae_dx": 0.0011555975070223212,
      "mae_dy": 0.0012743625557050109,
      "pose_mae_dtheta": 0.046893998980522156,
      "pose_mae_dx": 0.011389138177037239,
      "pose_mae_dy": 0.02102774940431118,
      "pose_rmse_dtheta": 0.1046663448214531,
      "pose_rmse_dx": 0.026658231392502785,
      "pose_rmse_dy": 0.04686744883656502,
      "pose_rmse_mean": 0.059397339820861816,
      "rmse_dtheta": 0.01600801758468151,
      "rmse_dx": 0.003747327718883753,
      "rmse_dy": 0.0027329151052981615,
      "rmse_mean": 0.00749608688056469,
      "rotation_flip": 0.00543970987200737,
      "sparse_tokens": 32121.0,
      "step": 7583,
      "turn_loss": 0.06227570027112961,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 39264.0,
      "epoch": 0.3523508641516447,
      "grad_norm": 0.9102205038070679,
      "learning_rate": 3.0402605214450897e-06,
      "loss": 0.2257,
      "mae_dtheta": 0.025837495923042297,
      "mae_dx": 0.008664019405841827,
      "mae_dy": 0.003817054210230708,
      "pose_mae_dtheta": 0.18504682183265686,
      "pose_mae_dx": 0.06793565303087234,
      "pose_mae_dy": 0.04236770048737526,
      "pose_rmse_dtheta": 0.36457759141921997,
      "pose_rmse_dx": 0.16980767250061035,
      "pose_rmse_dy": 0.1139724999666214,
      "pose_rmse_mean": 0.21611925959587097,
      "rmse_dtheta": 0.044122569262981415,
      "rmse_dx": 0.020208679139614105,
      "rmse_dy": 0.008141884580254555,
      "rmse_mean": 0.024157710373401642,
      "rotation_flip": 0.010650224052369595,
      "sparse_tokens": 29964.0,
      "step": 7584,
      "turn_loss": 0.20616912841796875,
      "turns": 121.0,
      "turns_per_sample": 121.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35239732391748746,
      "grad_norm": 0.6426698565483093,
      "learning_rate": 3.0390441650199727e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.012715511955320835,
      "mae_dx": 0.0017852546880021691,
      "mae_dy": 0.002931279828771949,
      "pose_mae_dtheta": 0.08841195702552795,
      "pose_mae_dx": 0.030558917671442032,
      "pose_mae_dy": 0.046477288007736206,
      "pose_rmse_dtheta": 0.16555480659008026,
      "pose_rmse_dx": 0.0730150118470192,
      "pose_rmse_dy": 0.09905831515789032,
      "pose_rmse_mean": 0.11254271119832993,
      "rmse_dtheta": 0.02298111282289028,
      "rmse_dx": 0.005492312368005514,
      "rmse_dy": 0.005667448975145817,
      "rmse_mean": 0.011380291543900967,
      "rotation_flip": 0.004779411945492029,
      "sparse_tokens": 32089.0,
      "step": 7585,
      "turn_loss": 0.11124434322118759,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29849.0,
      "epoch": 0.35244378368333024,
      "grad_norm": 0.8810330629348755,
      "learning_rate": 3.037827945725551e-06,
      "loss": 0.2102,
      "mae_dtheta": 0.029118098318576813,
      "mae_dx": 0.010363089852035046,
      "mae_dy": 0.005806957837194204,
      "pose_mae_dtheta": 0.21942241489887238,
      "pose_mae_dx": 0.07979976385831833,
      "pose_mae_dy": 0.07173880934715271,
      "pose_rmse_dtheta": 0.3733692467212677,
      "pose_rmse_dx": 0.16243912279605865,
      "pose_rmse_dy": 0.15379102528095245,
      "pose_rmse_mean": 0.22986647486686707,
      "rmse_dtheta": 0.04484744369983673,
      "rmse_dx": 0.021877488121390343,
      "rmse_dy": 0.010680141858756542,
      "rmse_mean": 0.02580169215798378,
      "rotation_flip": 0.012439530342817307,
      "sparse_tokens": 24027.0,
      "step": 7586,
      "turn_loss": 0.22134695947170258,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 36988.0,
      "epoch": 0.352490243449173,
      "grad_norm": 0.6382837295532227,
      "learning_rate": 3.036611863646873e-06,
      "loss": 0.1662,
      "mae_dtheta": 0.030505945906043053,
      "mae_dx": 0.010064936242997646,
      "mae_dy": 0.004100088495761156,
      "pose_mae_dtheta": 0.23124690353870392,
      "pose_mae_dx": 0.07443370670080185,
      "pose_mae_dy": 0.044163595885038376,
      "pose_rmse_dtheta": 0.4304756820201874,
      "pose_rmse_dx": 0.168202206492424,
      "pose_rmse_dy": 0.11329221725463867,
      "pose_rmse_mean": 0.23732337355613708,
      "rmse_dtheta": 0.04919731616973877,
      "rmse_dx": 0.02162199281156063,
      "rmse_dy": 0.008410369046032429,
      "rmse_mean": 0.026409894227981567,
      "rotation_flip": 0.01430274173617363,
      "sparse_tokens": 27953.0,
      "step": 7587,
      "turn_loss": 0.25973188877105713,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.3525367032150158,
      "grad_norm": 0.5916211009025574,
      "learning_rate": 3.0353959188689825e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.03728065639734268,
      "mae_dx": 0.014597883448004723,
      "mae_dy": 0.003293777583166957,
      "pose_mae_dtheta": 0.28871673345565796,
      "pose_mae_dx": 0.10838767141103745,
      "pose_mae_dy": 0.03243246674537659,
      "pose_rmse_dtheta": 0.5198894739151001,
      "pose_rmse_dx": 0.2516412138938904,
      "pose_rmse_dy": 0.07614076137542725,
      "pose_rmse_mean": 0.2825571596622467,
      "rmse_dtheta": 0.056883350014686584,
      "rmse_dx": 0.027638878673315048,
      "rmse_dy": 0.006583209149539471,
      "rmse_mean": 0.03036848083138466,
      "rotation_flip": 0.013527575880289078,
      "sparse_tokens": 14756.0,
      "step": 7588,
      "turn_loss": 0.25020936131477356,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.35258316298085857,
      "grad_norm": 0.40149226784706116,
      "learning_rate": 3.034180111476908e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.007720470428466797,
      "mae_dx": 0.00100515631493181,
      "mae_dy": 0.001757135963998735,
      "pose_mae_dtheta": 0.05355556309223175,
      "pose_mae_dx": 0.015274613164365292,
      "pose_mae_dy": 0.025651903823018074,
      "pose_rmse_dtheta": 0.09916234016418457,
      "pose_rmse_dx": 0.05018676817417145,
      "pose_rmse_dy": 0.05625972896814346,
      "pose_rmse_mean": 0.06853628158569336,
      "rmse_dtheta": 0.014503402635455132,
      "rmse_dx": 0.0038193841464817524,
      "rmse_dy": 0.0036556823179125786,
      "rmse_mean": 0.0073261559009552,
      "rotation_flip": 0.0008960573468357325,
      "sparse_tokens": 32057.0,
      "step": 7589,
      "turn_loss": 0.058398857712745667,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35262962274670134,
      "grad_norm": 0.5102271437644958,
      "learning_rate": 3.0329644415556757e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.011221237480640411,
      "mae_dx": 0.0030103628523647785,
      "mae_dy": 0.0034827126655727625,
      "pose_mae_dtheta": 0.0803585797548294,
      "pose_mae_dx": 0.029805216938257217,
      "pose_mae_dy": 0.03411205857992172,
      "pose_rmse_dtheta": 0.21008436381816864,
      "pose_rmse_dx": 0.08918769657611847,
      "pose_rmse_dy": 0.08047046512365341,
      "pose_rmse_mean": 0.1265808492898941,
      "rmse_dtheta": 0.024127338081598282,
      "rmse_dx": 0.010030989535152912,
      "rmse_dy": 0.008697557263076305,
      "rmse_mean": 0.014285295270383358,
      "rotation_flip": 0.006259780842810869,
      "sparse_tokens": 32089.0,
      "step": 7590,
      "turn_loss": 0.11260200291872025,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33634.0,
      "epoch": 0.3526760825125441,
      "grad_norm": 0.6821192502975464,
      "learning_rate": 3.0317489091902936e-06,
      "loss": 0.1752,
      "mae_dtheta": 0.035751767456531525,
      "mae_dx": 0.013677203096449375,
      "mae_dy": 0.004215183202177286,
      "pose_mae_dtheta": 0.3147788941860199,
      "pose_mae_dx": 0.12143756449222565,
      "pose_mae_dy": 0.0528317466378212,
      "pose_rmse_dtheta": 0.5326681733131409,
      "pose_rmse_dx": 0.27028295397758484,
      "pose_rmse_dy": 0.13053026795387268,
      "pose_rmse_mean": 0.31116044521331787,
      "rmse_dtheta": 0.05471567437052727,
      "rmse_dx": 0.02710914984345436,
      "rmse_dy": 0.00886657927185297,
      "rmse_mean": 0.03023046813905239,
      "rotation_flip": 0.00876601506024599,
      "sparse_tokens": 28647.0,
      "step": 7591,
      "turn_loss": 0.25146719813346863,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.3527225422783869,
      "grad_norm": 0.3335656225681305,
      "learning_rate": 3.0305335144657676e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.02629348821938038,
      "mae_dx": 0.0075740693137049675,
      "mae_dy": 0.00423657801002264,
      "pose_mae_dtheta": 0.15912345051765442,
      "pose_mae_dx": 0.05081401765346527,
      "pose_mae_dy": 0.045852240175008774,
      "pose_rmse_dtheta": 0.2853933274745941,
      "pose_rmse_dx": 0.10862814635038376,
      "pose_rmse_dy": 0.09219583868980408,
      "pose_rmse_mean": 0.16207244992256165,
      "rmse_dtheta": 0.043170180171728134,
      "rmse_dx": 0.017001423984766006,
      "rmse_dy": 0.00821346789598465,
      "rmse_mean": 0.022795025259256363,
      "rotation_flip": 0.013812154531478882,
      "sparse_tokens": 6999.0,
      "step": 7592,
      "turn_loss": 0.21794186532497406,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3527690020442297,
      "grad_norm": 0.5990549325942993,
      "learning_rate": 3.0293182574670904e-06,
      "loss": 0.1151,
      "mae_dtheta": 0.007952053099870682,
      "mae_dx": 0.0013585482956841588,
      "mae_dy": 0.0010531371226534247,
      "pose_mae_dtheta": 0.06131767854094505,
      "pose_mae_dx": 0.014355584047734737,
      "pose_mae_dy": 0.014717823825776577,
      "pose_rmse_dtheta": 0.22989803552627563,
      "pose_rmse_dx": 0.03619655221700668,
      "pose_rmse_dy": 0.04990242049098015,
      "pose_rmse_mean": 0.10533233731985092,
      "rmse_dtheta": 0.025503456592559814,
      "rmse_dx": 0.0038265737239271402,
      "rmse_dy": 0.0030815417412668467,
      "rmse_mean": 0.010803857818245888,
      "rotation_flip": 0.002160760574042797,
      "sparse_tokens": 32201.0,
      "step": 7593,
      "turn_loss": 0.04845504090189934,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.35281546181007245,
      "grad_norm": 0.4630073606967926,
      "learning_rate": 3.0281031382792448e-06,
      "loss": 0.0817,
      "mae_dtheta": 0.01005225908011198,
      "mae_dx": 0.003312278538942337,
      "mae_dy": 0.002804657444357872,
      "pose_mae_dtheta": 0.06851255148649216,
      "pose_mae_dx": 0.029091928154230118,
      "pose_mae_dy": 0.029559088870882988,
      "pose_rmse_dtheta": 0.16093599796295166,
      "pose_rmse_dx": 0.10129061341285706,
      "pose_rmse_dy": 0.08074863255023956,
      "pose_rmse_mean": 0.11432509124279022,
      "rmse_dtheta": 0.021555418148636818,
      "rmse_dx": 0.011432858183979988,
      "rmse_dy": 0.007450636941939592,
      "rmse_mean": 0.013479637913405895,
      "rotation_flip": 0.004119464661926031,
      "sparse_tokens": 32025.0,
      "step": 7594,
      "turn_loss": 0.09583617746829987,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3528619215759153,
      "grad_norm": 0.583515465259552,
      "learning_rate": 3.0268881569872055e-06,
      "loss": 0.1377,
      "mae_dtheta": 0.008857585489749908,
      "mae_dx": 0.0016320549184456468,
      "mae_dy": 0.0013947042170912027,
      "pose_mae_dtheta": 0.059331394731998444,
      "pose_mae_dx": 0.019558383151888847,
      "pose_mae_dy": 0.017582489177584648,
      "pose_rmse_dtheta": 0.1774694174528122,
      "pose_rmse_dx": 0.05011963099241257,
      "pose_rmse_dy": 0.04552445933222771,
      "pose_rmse_mean": 0.09103783220052719,
      "rmse_dtheta": 0.0230344757437706,
      "rmse_dx": 0.004685929976403713,
      "rmse_dy": 0.0033543903846293688,
      "rmse_mean": 0.010358266532421112,
      "rotation_flip": 0.0013850415125489235,
      "sparse_tokens": 32137.0,
      "step": 7595,
      "turn_loss": 0.06986668705940247,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.35290838134175806,
      "grad_norm": 0.6883285641670227,
      "learning_rate": 3.0256733136759363e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.009041396901011467,
      "mae_dx": 0.0010654882062226534,
      "mae_dy": 0.0016880892217159271,
      "pose_mae_dtheta": 0.06044470891356468,
      "pose_mae_dx": 0.016853217035531998,
      "pose_mae_dy": 0.024905497208237648,
      "pose_rmse_dtheta": 0.14625699818134308,
      "pose_rmse_dx": 0.0454217903316021,
      "pose_rmse_dy": 0.06203460320830345,
      "pose_rmse_mean": 0.08457113802433014,
      "rmse_dtheta": 0.01887746900320053,
      "rmse_dx": 0.003382953582331538,
      "rmse_dy": 0.0035095824860036373,
      "rmse_mean": 0.008590001612901688,
      "rotation_flip": 0.0011282437480986118,
      "sparse_tokens": 32073.0,
      "step": 7596,
      "turn_loss": 0.06392738968133926,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.35295484110760084,
      "grad_norm": 0.6266536116600037,
      "learning_rate": 3.0244586084303908e-06,
      "loss": 0.0944,
      "mae_dtheta": 0.010681905783712864,
      "mae_dx": 0.0027932776138186455,
      "mae_dy": 0.0016124120447784662,
      "pose_mae_dtheta": 0.07662629336118698,
      "pose_mae_dx": 0.03053581528365612,
      "pose_mae_dy": 0.024962911382317543,
      "pose_rmse_dtheta": 0.21268482506275177,
      "pose_rmse_dx": 0.08509654551744461,
      "pose_rmse_dy": 0.06176881119608879,
      "pose_rmse_mean": 0.11985006183385849,
      "rmse_dtheta": 0.026013435795903206,
      "rmse_dx": 0.00882242526859045,
      "rmse_dy": 0.003897150279954076,
      "rmse_mean": 0.012911003082990646,
      "rotation_flip": 0.004613019060343504,
      "sparse_tokens": 32073.0,
      "step": 7597,
      "turn_loss": 0.09044161438941956,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3530013008734436,
      "grad_norm": 0.4665432870388031,
      "learning_rate": 3.023244041335517e-06,
      "loss": 0.1195,
      "mae_dtheta": 0.0067239492200315,
      "mae_dx": 0.0022269333712756634,
      "mae_dy": 0.0018498953431844711,
      "pose_mae_dtheta": 0.03982975333929062,
      "pose_mae_dx": 0.01933477446436882,
      "pose_mae_dy": 0.020780913531780243,
      "pose_rmse_dtheta": 0.0932842344045639,
      "pose_rmse_dx": 0.07044688612222672,
      "pose_rmse_dy": 0.05733136832714081,
      "pose_rmse_mean": 0.07368750125169754,
      "rmse_dtheta": 0.015448377467691898,
      "rmse_dx": 0.008666757494211197,
      "rmse_dy": 0.004525668919086456,
      "rmse_mean": 0.009546934626996517,
      "rotation_flip": 0.004659832455217838,
      "sparse_tokens": 32089.0,
      "step": 7598,
      "turn_loss": 0.07866659015417099,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.3530477606392864,
      "grad_norm": 0.6312173008918762,
      "learning_rate": 3.0220296124762467e-06,
      "loss": 0.1265,
      "mae_dtheta": 0.02839437872171402,
      "mae_dx": 0.018141379579901695,
      "mae_dy": 0.009543050080537796,
      "pose_mae_dtheta": 0.21822047233581543,
      "pose_mae_dx": 0.1361972838640213,
      "pose_mae_dy": 0.09633257985115051,
      "pose_rmse_dtheta": 0.3923443555831909,
      "pose_rmse_dx": 0.27338796854019165,
      "pose_rmse_dy": 0.19851553440093994,
      "pose_rmse_mean": 0.28808262944221497,
      "rmse_dtheta": 0.045589931309223175,
      "rmse_dx": 0.03122435323894024,
      "rmse_dy": 0.016006942838430405,
      "rmse_mean": 0.030940409749746323,
      "rotation_flip": 0.011627906933426857,
      "sparse_tokens": 5473.0,
      "step": 7599,
      "turn_loss": 0.3866702616214752,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 27816.0,
      "epoch": 0.35309422040512917,
      "grad_norm": 0.662392795085907,
      "learning_rate": 3.020815321937509e-06,
      "loss": 0.149,
      "mae_dtheta": 0.03480343148112297,
      "mae_dx": 0.01245184801518917,
      "mae_dy": 0.005915751680731773,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6623929142951965,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 144.83956909179688,
      "model/head/act_norm_mean": 104.96881813226744,
      "model/head/act_norm_min": 67.51094055175781,
      "model/head/act_over_embed": 72.13555455405276,
      "model/head/grad_frac": 0.11050992459058762,
      "model/head/grad_norm": 0.07320099323987961,
      "model/head/grad_zero_frac": 0.00014055139035917819,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6917469113372093,
      "model/head/update_ratio": 0.0012476781848818064,
      "model/head/weight_delta": 9.57819652557373,
      "model/head/weight_delta_rel": 0.16802993416786194,
      "model/head/weight_norm": 58.66977310180664,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42218825221061707,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42218825221061707,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42218825221061707,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901317195078273,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07140965014696121,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04730124771595001,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001527714543044567,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0692434310913086,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10028175264596939,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96209716796875,
      "model/modality_embedder/grad_frac": 0.07140965014696121,
      "model/modality_embedder/grad_norm": 0.04730124771595001,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.001527714543044567,
      "model/modality_embedder/weight_delta": 3.0692434310913086,
      "model/modality_embedder/weight_delta_rel": 0.10028175264596939,
      "model/modality_embedder/weight_norm": 30.96209716796875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.92727661132812,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.160411475636767,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.123976707458496,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.916051597246053,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06219586730003357,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04119810089468956,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001475722063332796,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5443055629730225,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0927160307765007,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.91724967956543,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.53688049316406,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.977395948689555,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.714347839355469,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.477490975857073,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07047735899686813,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04668370261788368,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015718304784968495,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.22794246673584,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11181844770908356,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.700214385986328,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.49600982666016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.620452081026208,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.227099418640137,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.60661453253269,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07705726474523544,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.051042187958955765,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016644337447360158,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.487114667892456,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11709078401327133,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.666399002075195,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.48995208740234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.479042658730158,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.097336769104004,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.88385537792998,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07907488197088242,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05237864330410957,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017519835382699966,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.9858739376068115,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10204300284385681,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.896766662597656,
      "model/normalizer/grad_frac": 0.26369595527648926,
      "model/normalizer/grad_norm": 0.17467033863067627,
      "model/normalizer/grad_zero_frac": 0.00018789641035255045,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002222886309027672,
      "model/normalizer/weight_delta": 6.305179595947266,
      "model/normalizer/weight_delta_rel": 0.08120705932378769,
      "model/normalizer/weight_norm": 78.57817077636719,
      "pose_mae_dtheta": 0.282493531703949,
      "pose_mae_dx": 0.09804612398147583,
      "pose_mae_dy": 0.06246918439865112,
      "pose_rmse_dtheta": 0.532214343547821,
      "pose_rmse_dx": 0.21652399003505707,
      "pose_rmse_dy": 0.15158872306346893,
      "pose_rmse_mean": 0.30010902881622314,
      "rmse_dtheta": 0.055208735167980194,
      "rmse_dx": 0.02470632642507553,
      "rmse_dy": 0.013168622739613056,
      "rmse_mean": 0.03102789632976055,
      "rotation_flip": 0.012546125799417496,
      "sparse_tokens": 21576.0,
      "step": 7600,
      "turn_loss": 0.25853344798088074,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "epoch": 0.35309422040512917,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3079766035079956,
      "eval_objectnav_nopose_mae_dtheta": 0.03995677828788757,
      "eval_objectnav_nopose_mae_dx": 0.013021367602050304,
      "eval_objectnav_nopose_mae_dy": 0.004942215513437986,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31982558965682983,
      "eval_objectnav_nopose_pose_mae_dx": 0.10537837445735931,
      "eval_objectnav_nopose_pose_mae_dy": 0.056076645851135254,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5431344509124756,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23409707844257355,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13594117760658264,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30439090728759766,
      "eval_objectnav_nopose_rmse_dtheta": 0.05799834430217743,
      "eval_objectnav_nopose_rmse_dx": 0.025871219113469124,
      "eval_objectnav_nopose_rmse_dy": 0.010254396125674248,
      "eval_objectnav_nopose_rmse_mean": 0.03137465566396713,
      "eval_objectnav_nopose_rotation_flip": 0.014793074689805508,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3079766035079956,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 7600
    },
    {
      "epoch": 0.35309422040512917,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2757451832294464,
      "eval_objectnav_pose_mae_dtheta": 0.035341281443834305,
      "eval_objectnav_pose_mae_dx": 0.011572949588298798,
      "eval_objectnav_pose_mae_dy": 0.0044930181466042995,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2694639265537262,
      "eval_objectnav_pose_pose_mae_dx": 0.09075698256492615,
      "eval_objectnav_pose_pose_mae_dy": 0.04828696325421333,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4736364483833313,
      "eval_objectnav_pose_pose_rmse_dx": 0.210200235247612,
      "eval_objectnav_pose_pose_rmse_dy": 0.11841363459825516,
      "eval_objectnav_pose_pose_rmse_mean": 0.267416775226593,
      "eval_objectnav_pose_rmse_dtheta": 0.053167425096035004,
      "eval_objectnav_pose_rmse_dx": 0.024011826142668724,
      "eval_objectnav_pose_rmse_dy": 0.009410924278199673,
      "eval_objectnav_pose_rmse_mean": 0.028863392770290375,
      "eval_objectnav_pose_rotation_flip": 0.01461878977715969,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2757451832294464,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 7600
    },
    {
      "epoch": 0.35309422040512917,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09237470477819443,
      "eval_pointnav_mae_dtheta": 0.010136897675693035,
      "eval_pointnav_mae_dx": 0.002400764496996999,
      "eval_pointnav_mae_dy": 0.0023492006585001945,
      "eval_pointnav_pose_mae_dtheta": 0.0697406455874443,
      "eval_pointnav_pose_mae_dx": 0.02699439972639084,
      "eval_pointnav_pose_mae_dy": 0.025241902098059654,
      "eval_pointnav_pose_rmse_dtheta": 0.20181870460510254,
      "eval_pointnav_pose_rmse_dx": 0.08136947453022003,
      "eval_pointnav_pose_rmse_dy": 0.07390522211790085,
      "eval_pointnav_pose_rmse_mean": 0.11903113126754761,
      "eval_pointnav_rmse_dtheta": 0.025116287171840668,
      "eval_pointnav_rmse_dx": 0.0075029111467301846,
      "eval_pointnav_rmse_dy": 0.006354064680635929,
      "eval_pointnav_rmse_mean": 0.012991087511181831,
      "eval_pointnav_rotation_flip": 0.004575628787279129,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09237470477819443,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 7600
    },
    {
      "epoch": 0.35309422040512917,
      "eval_loss": 0.22536549717187881,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3079766035079956,
      "eval_objectnav_nopose_mae_dtheta": 0.03995677828788757,
      "eval_objectnav_nopose_mae_dx": 0.013021367602050304,
      "eval_objectnav_nopose_mae_dy": 0.004942215513437986,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31982558965682983,
      "eval_objectnav_nopose_pose_mae_dx": 0.10537837445735931,
      "eval_objectnav_nopose_pose_mae_dy": 0.056076645851135254,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5431344509124756,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23409707844257355,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13594117760658264,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30439090728759766,
      "eval_objectnav_nopose_rmse_dtheta": 0.05799834430217743,
      "eval_objectnav_nopose_rmse_dx": 0.025871219113469124,
      "eval_objectnav_nopose_rmse_dy": 0.010254396125674248,
      "eval_objectnav_nopose_rmse_mean": 0.03137465566396713,
      "eval_objectnav_nopose_rotation_flip": 0.014793074689805508,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3079766035079956,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2757451832294464,
      "eval_objectnav_pose_mae_dtheta": 0.035341281443834305,
      "eval_objectnav_pose_mae_dx": 0.011572949588298798,
      "eval_objectnav_pose_mae_dy": 0.0044930181466042995,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2694639265537262,
      "eval_objectnav_pose_pose_mae_dx": 0.09075698256492615,
      "eval_objectnav_pose_pose_mae_dy": 0.04828696325421333,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4736364483833313,
      "eval_objectnav_pose_pose_rmse_dx": 0.210200235247612,
      "eval_objectnav_pose_pose_rmse_dy": 0.11841363459825516,
      "eval_objectnav_pose_pose_rmse_mean": 0.267416775226593,
      "eval_objectnav_pose_rmse_dtheta": 0.053167425096035004,
      "eval_objectnav_pose_rmse_dx": 0.024011826142668724,
      "eval_objectnav_pose_rmse_dy": 0.009410924278199673,
      "eval_objectnav_pose_rmse_mean": 0.028863392770290375,
      "eval_objectnav_pose_rotation_flip": 0.01461878977715969,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2757451832294464,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09237470477819443,
      "eval_pointnav_mae_dtheta": 0.010136897675693035,
      "eval_pointnav_mae_dx": 0.002400764496996999,
      "eval_pointnav_mae_dy": 0.0023492006585001945,
      "eval_pointnav_pose_mae_dtheta": 0.0697406455874443,
      "eval_pointnav_pose_mae_dx": 0.02699439972639084,
      "eval_pointnav_pose_mae_dy": 0.025241902098059654,
      "eval_pointnav_pose_rmse_dtheta": 0.20181870460510254,
      "eval_pointnav_pose_rmse_dx": 0.08136947453022003,
      "eval_pointnav_pose_rmse_dy": 0.07390522211790085,
      "eval_pointnav_pose_rmse_mean": 0.11903113126754761,
      "eval_pointnav_rmse_dtheta": 0.025116287171840668,
      "eval_pointnav_rmse_dx": 0.0075029111467301846,
      "eval_pointnav_rmse_dy": 0.006354064680635929,
      "eval_pointnav_rmse_mean": 0.012991087511181831,
      "eval_pointnav_rotation_flip": 0.004575628787279129,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09237470477819443,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 7600
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.35314068017097194,
      "grad_norm": 0.5051984786987305,
      "learning_rate": 3.019601169804216e-06,
      "loss": 0.1314,
      "mae_dtheta": 0.009749139659106731,
      "mae_dx": 0.0031952164135873318,
      "mae_dy": 0.0010627207811921835,
      "pose_mae_dtheta": 0.07030591368675232,
      "pose_mae_dx": 0.03022252954542637,
      "pose_mae_dy": 0.015229450538754463,
      "pose_rmse_dtheta": 0.24699866771697998,
      "pose_rmse_dx": 0.0985054299235344,
      "pose_rmse_dy": 0.04228321462869644,
      "pose_rmse_mean": 0.12926244735717773,
      "rmse_dtheta": 0.029309216886758804,
      "rmse_dx": 0.010214555077254772,
      "rmse_dy": 0.0025341049768030643,
      "rmse_mean": 0.014019293710589409,
      "rotation_flip": 0.006155950948596001,
      "sparse_tokens": 32121.0,
      "step": 7601,
      "turn_loss": 0.1044827401638031,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3531871399368147,
      "grad_norm": 0.6317113637924194,
      "learning_rate": 3.0183871561612786e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.005947504658252001,
      "mae_dx": 0.0011855083284899592,
      "mae_dy": 0.0008642768952995539,
      "pose_mae_dtheta": 0.043417930603027344,
      "pose_mae_dx": 0.013765226118266582,
      "pose_mae_dy": 0.012635870836675167,
      "pose_rmse_dtheta": 0.15240886807441711,
      "pose_rmse_dx": 0.03380649536848068,
      "pose_rmse_dy": 0.03448360413312912,
      "pose_rmse_mean": 0.07356633245944977,
      "rmse_dtheta": 0.01814649999141693,
      "rmse_dx": 0.003752251621335745,
      "rmse_dy": 0.0017858627252280712,
      "rmse_mean": 0.00789487175643444,
      "rotation_flip": 0.0029069767333567142,
      "sparse_tokens": 32137.0,
      "step": 7602,
      "turn_loss": 0.03997797891497612,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.3532335997026575,
      "grad_norm": 0.4141072630882263,
      "learning_rate": 3.0171732810935887e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.026517843827605247,
      "mae_dx": 0.008117832243442535,
      "mae_dy": 0.004300018772482872,
      "pose_mae_dtheta": 0.19603531062602997,
      "pose_mae_dx": 0.059442631900310516,
      "pose_mae_dy": 0.040478549897670746,
      "pose_rmse_dtheta": 0.3920324444770813,
      "pose_rmse_dx": 0.14655709266662598,
      "pose_rmse_dy": 0.12599512934684753,
      "pose_rmse_mean": 0.22152821719646454,
      "rmse_dtheta": 0.0449579618871212,
      "rmse_dx": 0.019874729216098785,
      "rmse_dy": 0.00970887765288353,
      "rmse_mean": 0.02484719082713127,
      "rotation_flip": 0.011450381949543953,
      "sparse_tokens": 13017.0,
      "step": 7603,
      "turn_loss": 0.214122012257576,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 23941.0,
      "epoch": 0.3532800594685003,
      "grad_norm": 0.6475797295570374,
      "learning_rate": 3.0159595446860355e-06,
      "loss": 0.166,
      "mae_dtheta": 0.037638530135154724,
      "mae_dx": 0.014650247059762478,
      "mae_dy": 0.004849849734455347,
      "pose_mae_dtheta": 0.31067007780075073,
      "pose_mae_dx": 0.12146561592817307,
      "pose_mae_dy": 0.05422249063849449,
      "pose_rmse_dtheta": 0.5438172817230225,
      "pose_rmse_dx": 0.24509117007255554,
      "pose_rmse_dy": 0.11628850549459457,
      "pose_rmse_mean": 0.3017323315143585,
      "rmse_dtheta": 0.056309446692466736,
      "rmse_dx": 0.027355138212442398,
      "rmse_dy": 0.008781682699918747,
      "rmse_mean": 0.030815422534942627,
      "rotation_flip": 0.008410428650677204,
      "sparse_tokens": 19556.0,
      "step": 7604,
      "turn_loss": 0.2954951524734497,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.35332651923434305,
      "grad_norm": 0.427857369184494,
      "learning_rate": 3.0147459470234984e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.007778221741318703,
      "mae_dx": 0.0015990703832358122,
      "mae_dy": 0.001995851518586278,
      "pose_mae_dtheta": 0.055436551570892334,
      "pose_mae_dx": 0.018729297444224358,
      "pose_mae_dy": 0.021634316071867943,
      "pose_rmse_dtheta": 0.15885475277900696,
      "pose_rmse_dx": 0.05307596176862717,
      "pose_rmse_dy": 0.05746489018201828,
      "pose_rmse_mean": 0.08979853987693787,
      "rmse_dtheta": 0.020626625046133995,
      "rmse_dx": 0.004991080611944199,
      "rmse_dy": 0.005673678126186132,
      "rmse_mean": 0.01043046172708273,
      "rotation_flip": 0.004704875871539116,
      "sparse_tokens": 32073.0,
      "step": 7605,
      "turn_loss": 0.0684654712677002,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.3533729790001858,
      "grad_norm": 0.4662308692932129,
      "learning_rate": 3.0135324881908405e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.02357049286365509,
      "mae_dx": 0.007025878876447678,
      "mae_dy": 0.0032139080576598644,
      "pose_mae_dtheta": 0.14304611086845398,
      "pose_mae_dx": 0.04153456538915634,
      "pose_mae_dy": 0.045742060989141464,
      "pose_rmse_dtheta": 0.2683960795402527,
      "pose_rmse_dx": 0.09821523725986481,
      "pose_rmse_dy": 0.09659454226493835,
      "pose_rmse_mean": 0.154401957988739,
      "rmse_dtheta": 0.04057157039642334,
      "rmse_dx": 0.01742485910654068,
      "rmse_dy": 0.005448341369628906,
      "rmse_mean": 0.021148256957530975,
      "rotation_flip": 0.006779660936444998,
      "sparse_tokens": 11495.0,
      "step": 7606,
      "turn_loss": 0.17873890697956085,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3534194387660286,
      "grad_norm": 0.4700525403022766,
      "learning_rate": 3.0123191682729246e-06,
      "loss": 0.0761,
      "mae_dtheta": 0.008337678387761116,
      "mae_dx": 0.001600613002665341,
      "mae_dy": 0.0010380195453763008,
      "pose_mae_dtheta": 0.058309156447649,
      "pose_mae_dx": 0.016173409298062325,
      "pose_mae_dy": 0.016448192298412323,
      "pose_rmse_dtheta": 0.19065789878368378,
      "pose_rmse_dx": 0.03454606980085373,
      "pose_rmse_dy": 0.037370581179857254,
      "pose_rmse_mean": 0.08752485364675522,
      "rmse_dtheta": 0.023641107603907585,
      "rmse_dx": 0.00483706034719944,
      "rmse_dy": 0.0022943385411053896,
      "rmse_mean": 0.010257503017783165,
      "rotation_flip": 0.00644814595580101,
      "sparse_tokens": 32105.0,
      "step": 7607,
      "turn_loss": 0.06919340789318085,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3534658985318714,
      "grad_norm": 0.47216370701789856,
      "learning_rate": 3.0111059873545935e-06,
      "loss": 0.0783,
      "mae_dtheta": 0.005705581046640873,
      "mae_dx": 0.001179892336949706,
      "mae_dy": 0.0008162157027982175,
      "pose_mae_dtheta": 0.04319171980023384,
      "pose_mae_dx": 0.010320489294826984,
      "pose_mae_dy": 0.012109066359698772,
      "pose_rmse_dtheta": 0.15972889959812164,
      "pose_rmse_dx": 0.02545054629445076,
      "pose_rmse_dy": 0.0332207977771759,
      "pose_rmse_mean": 0.07280008494853973,
      "rmse_dtheta": 0.017841650173068047,
      "rmse_dx": 0.0037810171488672495,
      "rmse_dy": 0.002035448094829917,
      "rmse_mean": 0.007886039093136787,
      "rotation_flip": 0.002310536103323102,
      "sparse_tokens": 32169.0,
      "step": 7608,
      "turn_loss": 0.03777741268277168,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.35351235829771416,
      "grad_norm": 0.6402817964553833,
      "learning_rate": 3.0098929455206905e-06,
      "loss": 0.1786,
      "mae_dtheta": 0.007560656871646643,
      "mae_dx": 0.0011784808011725545,
      "mae_dy": 0.0016293181106448174,
      "pose_mae_dtheta": 0.0566527396440506,
      "pose_mae_dx": 0.01646554470062256,
      "pose_mae_dy": 0.023080110549926758,
      "pose_rmse_dtheta": 0.14729809761047363,
      "pose_rmse_dx": 0.050782207399606705,
      "pose_rmse_dy": 0.06806138902902603,
      "pose_rmse_mean": 0.08871389925479889,
      "rmse_dtheta": 0.01799282431602478,
      "rmse_dx": 0.00425892835482955,
      "rmse_dy": 0.004246396478265524,
      "rmse_mean": 0.008832717314362526,
      "rotation_flip": 0.0027731559239327908,
      "sparse_tokens": 32057.0,
      "step": 7609,
      "turn_loss": 0.06163014844059944,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35355881806355693,
      "grad_norm": 0.5137316584587097,
      "learning_rate": 3.0086800428560394e-06,
      "loss": 0.0887,
      "mae_dtheta": 0.006640116684138775,
      "mae_dx": 0.0009734266204759479,
      "mae_dy": 0.0016060557682067156,
      "pose_mae_dtheta": 0.045579131692647934,
      "pose_mae_dx": 0.014187756925821304,
      "pose_mae_dy": 0.021745748817920685,
      "pose_rmse_dtheta": 0.12408600002527237,
      "pose_rmse_dx": 0.04397403076291084,
      "pose_rmse_dy": 0.07026038318872452,
      "pose_rmse_mean": 0.07944013923406601,
      "rmse_dtheta": 0.01714363880455494,
      "rmse_dx": 0.002782875206321478,
      "rmse_dy": 0.004084094427525997,
      "rmse_mean": 0.008003536611795425,
      "rotation_flip": 0.0019417476141825318,
      "sparse_tokens": 32089.0,
      "step": 7610,
      "turn_loss": 0.056145645678043365,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.35360527782939977,
      "grad_norm": 0.4301043152809143,
      "learning_rate": 3.007467279445463e-06,
      "loss": 0.0845,
      "mae_dtheta": 0.009257563389837742,
      "mae_dx": 0.0015343634877353907,
      "mae_dy": 0.0018611940322443843,
      "pose_mae_dtheta": 0.06170663610100746,
      "pose_mae_dx": 0.018979592248797417,
      "pose_mae_dy": 0.020612653344869614,
      "pose_rmse_dtheta": 0.19256596267223358,
      "pose_rmse_dx": 0.04645511135458946,
      "pose_rmse_dy": 0.04683105647563934,
      "pose_rmse_mean": 0.09528404474258423,
      "rmse_dtheta": 0.022705035284161568,
      "rmse_dx": 0.00463694566860795,
      "rmse_dy": 0.00407796073704958,
      "rmse_mean": 0.010473313741385937,
      "rotation_flip": 0.0028723841533064842,
      "sparse_tokens": 32105.0,
      "step": 7611,
      "turn_loss": 0.07301106303930283,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11344.0,
      "epoch": 0.35365173759524254,
      "grad_norm": 0.8338907957077026,
      "learning_rate": 3.0062546553737692e-06,
      "loss": 0.1522,
      "mae_dtheta": 0.034950848668813705,
      "mae_dx": 0.014591241255402565,
      "mae_dy": 0.007071168627589941,
      "pose_mae_dtheta": 0.25867512822151184,
      "pose_mae_dx": 0.1059667319059372,
      "pose_mae_dy": 0.09920153021812439,
      "pose_rmse_dtheta": 0.4843294322490692,
      "pose_rmse_dx": 0.22816027700901031,
      "pose_rmse_dy": 0.2138248234987259,
      "pose_rmse_mean": 0.3087715208530426,
      "rmse_dtheta": 0.0534830316901207,
      "rmse_dx": 0.028341207653284073,
      "rmse_dy": 0.013899032957851887,
      "rmse_mean": 0.031907759606838226,
      "rotation_flip": 0.014260249212384224,
      "sparse_tokens": 9762.0,
      "step": 7612,
      "turn_loss": 0.2558654844760895,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3536981973610853,
      "grad_norm": 0.48298102617263794,
      "learning_rate": 3.005042170725758e-06,
      "loss": 0.0916,
      "mae_dtheta": 0.006647275760769844,
      "mae_dx": 0.0012171936687082052,
      "mae_dy": 0.00142974266782403,
      "pose_mae_dtheta": 0.03951390087604523,
      "pose_mae_dx": 0.014615416526794434,
      "pose_mae_dy": 0.0182216577231884,
      "pose_rmse_dtheta": 0.09283499419689178,
      "pose_rmse_dx": 0.03735089674592018,
      "pose_rmse_dy": 0.04000651463866234,
      "pose_rmse_mean": 0.05673080310225487,
      "rmse_dtheta": 0.015557036735117435,
      "rmse_dx": 0.004004936199635267,
      "rmse_dy": 0.0029467714484781027,
      "rmse_mean": 0.007502914872020483,
      "rotation_flip": 0.004884547088295221,
      "sparse_tokens": 32089.0,
      "step": 7613,
      "turn_loss": 0.05471177026629448,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.3537446571269281,
      "grad_norm": 0.4713191092014313,
      "learning_rate": 3.003829825586218e-06,
      "loss": 0.107,
      "mae_dtheta": 0.02522316388785839,
      "mae_dx": 0.008591200225055218,
      "mae_dy": 0.003659324487671256,
      "pose_mae_dtheta": 0.1708260327577591,
      "pose_mae_dx": 0.07198691368103027,
      "pose_mae_dy": 0.04702538251876831,
      "pose_rmse_dtheta": 0.37448325753211975,
      "pose_rmse_dx": 0.19111935794353485,
      "pose_rmse_dy": 0.11947424709796906,
      "pose_rmse_mean": 0.22835895419120789,
      "rmse_dtheta": 0.04492412880063057,
      "rmse_dx": 0.021576473489403725,
      "rmse_dy": 0.007322411052882671,
      "rmse_mean": 0.024607671424746513,
      "rotation_flip": 0.01767151802778244,
      "sparse_tokens": 20238.0,
      "step": 7614,
      "turn_loss": 0.17284806072711945,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.3537911168927709,
      "grad_norm": 0.6423940062522888,
      "learning_rate": 3.00261762003993e-06,
      "loss": 0.0694,
      "mae_dtheta": 0.02263147197663784,
      "mae_dx": 0.00316756428219378,
      "mae_dy": 0.0017839004285633564,
      "pose_mae_dtheta": 0.199142724275589,
      "pose_mae_dx": 0.026961466297507286,
      "pose_mae_dy": 0.02534092776477337,
      "pose_rmse_dtheta": 0.49438485503196716,
      "pose_rmse_dx": 0.08095778524875641,
      "pose_rmse_dy": 0.06464485079050064,
      "pose_rmse_mean": 0.21332918107509613,
      "rmse_dtheta": 0.04477359727025032,
      "rmse_dx": 0.009375371970236301,
      "rmse_dy": 0.004023184534162283,
      "rmse_mean": 0.019390717148780823,
      "rotation_flip": 0.004065040498971939,
      "sparse_tokens": 5067.0,
      "step": 7615,
      "turn_loss": 0.12214092165231705,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.35383757665861365,
      "grad_norm": 0.8794858455657959,
      "learning_rate": 3.0014055541716637e-06,
      "loss": 0.1499,
      "mae_dtheta": 0.05054653063416481,
      "mae_dx": 0.015362326987087727,
      "mae_dy": 0.0033419744577258825,
      "pose_mae_dtheta": 0.42558103799819946,
      "pose_mae_dx": 0.12836101651191711,
      "pose_mae_dy": 0.046667102724313736,
      "pose_rmse_dtheta": 0.6618781089782715,
      "pose_rmse_dx": 0.26089346408843994,
      "pose_rmse_dy": 0.14061810076236725,
      "pose_rmse_mean": 0.35446321964263916,
      "rmse_dtheta": 0.06773877143859863,
      "rmse_dx": 0.027432246133685112,
      "rmse_dy": 0.0076197003945708275,
      "rmse_mean": 0.034263573586940765,
      "rotation_flip": 0.00691244238987565,
      "sparse_tokens": 12395.0,
      "step": 7616,
      "turn_loss": 0.32208847999572754,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3538840364244564,
      "grad_norm": 0.42957091331481934,
      "learning_rate": 3.0001936280661794e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.01517119724303484,
      "mae_dx": 0.0030063556041568518,
      "mae_dy": 0.005081893410533667,
      "pose_mae_dtheta": 0.1095803827047348,
      "pose_mae_dx": 0.03612177073955536,
      "pose_mae_dy": 0.042614083737134933,
      "pose_rmse_dtheta": 0.2573440670967102,
      "pose_rmse_dx": 0.09300775825977325,
      "pose_rmse_dy": 0.08778738975524902,
      "pose_rmse_mean": 0.14604640007019043,
      "rmse_dtheta": 0.03094886988401413,
      "rmse_dx": 0.008320358581840992,
      "rmse_dy": 0.010227174498140812,
      "rmse_mean": 0.016498800367116928,
      "rotation_flip": 0.008567512035369873,
      "sparse_tokens": 32089.0,
      "step": 7617,
      "turn_loss": 0.1455707550048828,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27254.0,
      "epoch": 0.3539304961902992,
      "grad_norm": 0.5457530617713928,
      "learning_rate": 2.998981841808227e-06,
      "loss": 0.1584,
      "mae_dtheta": 0.024311300367116928,
      "mae_dx": 0.010007716715335846,
      "mae_dy": 0.00472415192052722,
      "pose_mae_dtheta": 0.1797761768102646,
      "pose_mae_dx": 0.08014293015003204,
      "pose_mae_dy": 0.06120804324746132,
      "pose_rmse_dtheta": 0.34294041991233826,
      "pose_rmse_dx": 0.20756009221076965,
      "pose_rmse_dy": 0.1440369337797165,
      "pose_rmse_mean": 0.23151248693466187,
      "rmse_dtheta": 0.04078061506152153,
      "rmse_dx": 0.023778146132826805,
      "rmse_dy": 0.009665594436228275,
      "rmse_mean": 0.02474145218729973,
      "rotation_flip": 0.009380863048136234,
      "sparse_tokens": 21923.0,
      "step": 7618,
      "turn_loss": 0.2224365472793579,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.353976955956142,
      "grad_norm": 0.3057078421115875,
      "learning_rate": 2.997770195482551e-06,
      "loss": 0.0768,
      "mae_dtheta": 0.005849141161888838,
      "mae_dx": 0.000884119188413024,
      "mae_dy": 0.001213442301377654,
      "pose_mae_dtheta": 0.036350563168525696,
      "pose_mae_dx": 0.010641702450811863,
      "pose_mae_dy": 0.015734389424324036,
      "pose_rmse_dtheta": 0.08529377728700638,
      "pose_rmse_dx": 0.02693190984427929,
      "pose_rmse_dy": 0.037031106650829315,
      "pose_rmse_mean": 0.049752265214920044,
      "rmse_dtheta": 0.014791091904044151,
      "rmse_dx": 0.002797860186547041,
      "rmse_dy": 0.002939247991889715,
      "rmse_mean": 0.0068427338264882565,
      "rotation_flip": 0.005090236198157072,
      "sparse_tokens": 32105.0,
      "step": 7619,
      "turn_loss": 0.0412532202899456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.35402341572198476,
      "grad_norm": 1.0381147861480713,
      "learning_rate": 2.9965586891738783e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.011034220457077026,
      "mae_dx": 0.0011994150700047612,
      "mae_dy": 0.002348368288949132,
      "pose_mae_dtheta": 0.06974108517169952,
      "pose_mae_dx": 0.016818096861243248,
      "pose_mae_dy": 0.0298970527946949,
      "pose_rmse_dtheta": 0.13232927024364471,
      "pose_rmse_dx": 0.040503691881895065,
      "pose_rmse_dy": 0.06394936144351959,
      "pose_rmse_mean": 0.07892744243144989,
      "rmse_dtheta": 0.019882807508111,
      "rmse_dx": 0.0036193490959703922,
      "rmse_dy": 0.0048693157732486725,
      "rmse_mean": 0.009457157924771309,
      "rotation_flip": 0.007630813866853714,
      "sparse_tokens": 32073.0,
      "step": 7620,
      "turn_loss": 0.0783732682466507,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.35406987548782753,
      "grad_norm": 0.38867148756980896,
      "learning_rate": 2.995347322966933e-06,
      "loss": 0.0745,
      "mae_dtheta": 0.008679238148033619,
      "mae_dx": 0.0017453128239139915,
      "mae_dy": 0.001394540653564036,
      "pose_mae_dtheta": 0.05402807891368866,
      "pose_mae_dx": 0.018704643473029137,
      "pose_mae_dy": 0.01706807129085064,
      "pose_rmse_dtheta": 0.16804391145706177,
      "pose_rmse_dx": 0.04425565525889397,
      "pose_rmse_dy": 0.0449511893093586,
      "pose_rmse_mean": 0.08575025200843811,
      "rmse_dtheta": 0.022307446226477623,
      "rmse_dx": 0.00513133080676198,
      "rmse_dy": 0.0035236955154687166,
      "rmse_mean": 0.010320824570953846,
      "rotation_flip": 0.0028409091755747795,
      "sparse_tokens": 32217.0,
      "step": 7621,
      "turn_loss": 0.06768439710140228,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.3541163352536703,
      "grad_norm": 0.6214931607246399,
      "learning_rate": 2.994136096946424e-06,
      "loss": 0.1689,
      "mae_dtheta": 0.03565477952361107,
      "mae_dx": 0.013996407389640808,
      "mae_dy": 0.0069614979438483715,
      "pose_mae_dtheta": 0.362140953540802,
      "pose_mae_dx": 0.11558590084314346,
      "pose_mae_dy": 0.06424611806869507,
      "pose_rmse_dtheta": 0.5553535223007202,
      "pose_rmse_dx": 0.2644515335559845,
      "pose_rmse_dy": 0.12327118963003159,
      "pose_rmse_mean": 0.31435874104499817,
      "rmse_dtheta": 0.052276529371738434,
      "rmse_dx": 0.027209613472223282,
      "rmse_dy": 0.013754909858107567,
      "rmse_mean": 0.031080354005098343,
      "rotation_flip": 0.009230769239366055,
      "sparse_tokens": 4712.0,
      "step": 7622,
      "turn_loss": 0.44593334197998047,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3541627950195131,
      "grad_norm": 0.5754212737083435,
      "learning_rate": 2.9929250111970533e-06,
      "loss": 0.146,
      "mae_dtheta": 0.0066422466188669205,
      "mae_dx": 0.0011904134880751371,
      "mae_dy": 0.0015169044490903616,
      "pose_mae_dtheta": 0.044461917132139206,
      "pose_mae_dx": 0.012358151376247406,
      "pose_mae_dy": 0.015891119837760925,
      "pose_rmse_dtheta": 0.12135032564401627,
      "pose_rmse_dx": 0.03457573428750038,
      "pose_rmse_dy": 0.04345820099115372,
      "pose_rmse_mean": 0.06646142899990082,
      "rmse_dtheta": 0.017382491379976273,
      "rmse_dx": 0.0037466250360012054,
      "rmse_dy": 0.004270354751497507,
      "rmse_mean": 0.008466490544378757,
      "rotation_flip": 0.0029880478978157043,
      "sparse_tokens": 32089.0,
      "step": 7623,
      "turn_loss": 0.05284096673130989,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.35420925478535586,
      "grad_norm": 0.3555484414100647,
      "learning_rate": 2.9917140658035164e-06,
      "loss": 0.0765,
      "mae_dtheta": 0.013583052903413773,
      "mae_dx": 0.002239732537418604,
      "mae_dy": 0.003371464554220438,
      "pose_mae_dtheta": 0.09072794765233994,
      "pose_mae_dx": 0.028675870969891548,
      "pose_mae_dy": 0.03451282158493996,
      "pose_rmse_dtheta": 0.19309476017951965,
      "pose_rmse_dx": 0.06833375245332718,
      "pose_rmse_dy": 0.07055342942476273,
      "pose_rmse_mean": 0.11066064238548279,
      "rmse_dtheta": 0.02584926038980484,
      "rmse_dx": 0.006163499783724546,
      "rmse_dy": 0.006614933721721172,
      "rmse_mean": 0.012875898741185665,
      "rotation_flip": 0.009351821616292,
      "sparse_tokens": 32121.0,
      "step": 7624,
      "turn_loss": 0.10863747447729111,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.35425571455119864,
      "grad_norm": 0.3860536217689514,
      "learning_rate": 2.9905032608504913e-06,
      "loss": 0.0821,
      "mae_dtheta": 0.029266096651554108,
      "mae_dx": 0.013060454279184341,
      "mae_dy": 0.0035512770991772413,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.38605380058288574,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.84588623046875,
      "model/head/act_norm_mean": 110.67953330592105,
      "model/head/act_norm_min": 71.99044036865234,
      "model/head/act_over_embed": 76.06001148594532,
      "model/head/grad_frac": 0.09441743046045303,
      "model/head/grad_norm": 0.036450207233428955,
      "model/head/grad_zero_frac": 0.00019290123600512743,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6939761513157895,
      "model/head/update_ratio": 0.0006212626467458904,
      "model/head/weight_delta": 9.584742546081543,
      "model/head/weight_delta_rel": 0.16814477741718292,
      "model/head/weight_norm": 58.671173095703125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42218753695487976,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42218753695487976,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42218753695487976,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901312279773883,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10655403882265091,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04113559052348137,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 1.6851784039317863e-06,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013285791501402855,
      "model/modality_embedder.encoders.pose/weight_delta": 3.07320499420166,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10041118413209915,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96209144592285,
      "model/modality_embedder/grad_frac": 0.10655403882265091,
      "model/modality_embedder/grad_norm": 0.04113559052348137,
      "model/modality_embedder/grad_zero_frac": 1.6851784039317863e-06,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0013285791501402855,
      "model/modality_embedder/weight_delta": 3.07320499420166,
      "model/modality_embedder/weight_delta_rel": 0.10041118413209915,
      "model/modality_embedder/weight_norm": 30.96209144592285,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.11392974853516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.667803949979113,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.072813034057617,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.2647364558973,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08032382279634476,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.031009316444396973,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011107376776635647,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5472843647003174,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09282457828521729,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.917766571044922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.50355529785156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.4679374216792,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.789173126220703,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.814595668617184,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08399435132741928,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03242633864283562,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010917455656453967,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.231924295425415,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11195638030767441,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.70136833190918,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.0945053100586,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.074840421365916,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.21359634399414,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.918874454064802,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07817155122756958,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030178425833582878,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000984051963314414,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.491483211517334,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11723747104406357,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.667510986328125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.3186264038086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.88847117794486,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.975671768188477,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.16521848946451,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07977674156427383,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.030798114836215973,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010301178554072976,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.989737033843994,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1021750271320343,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.897661209106445,
      "model/normalizer/grad_frac": 0.33070316910743713,
      "model/normalizer/grad_norm": 0.12766921520233154,
      "model/normalizer/grad_zero_frac": 0.00019616857753135264,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001624717959202826,
      "model/normalizer/weight_delta": 6.3130388259887695,
      "model/normalizer/weight_delta_rel": 0.0813082829117775,
      "model/normalizer/weight_norm": 78.57930755615234,
      "pose_mae_dtheta": 0.24163371324539185,
      "pose_mae_dx": 0.11140308529138565,
      "pose_mae_dy": 0.04194634407758713,
      "pose_rmse_dtheta": 0.4597720503807068,
      "pose_rmse_dx": 0.22487817704677582,
      "pose_rmse_dy": 0.08575620502233505,
      "pose_rmse_mean": 0.25680214166641235,
      "rmse_dtheta": 0.047505851835012436,
      "rmse_dx": 0.02504785917699337,
      "rmse_dy": 0.006825254764407873,
      "rmse_mean": 0.026459654793143272,
      "rotation_flip": 0.006666666828095913,
      "sparse_tokens": 20798.0,
      "step": 7625,
      "turn_loss": 0.24552786350250244,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3543021743170414,
      "grad_norm": 0.48678892850875854,
      "learning_rate": 2.9892925964226527e-06,
      "loss": 0.091,
      "mae_dtheta": 0.00896700844168663,
      "mae_dx": 0.0020251115784049034,
      "mae_dy": 0.00201233453117311,
      "pose_mae_dtheta": 0.06593652069568634,
      "pose_mae_dx": 0.022704070433974266,
      "pose_mae_dy": 0.019636256620287895,
      "pose_rmse_dtheta": 0.21552813053131104,
      "pose_rmse_dx": 0.08150827884674072,
      "pose_rmse_dy": 0.055092036724090576,
      "pose_rmse_mean": 0.11737614870071411,
      "rmse_dtheta": 0.024000445380806923,
      "rmse_dx": 0.0065301512368023396,
      "rmse_dy": 0.006400281097739935,
      "rmse_mean": 0.012310292571783066,
      "rotation_flip": 0.006887052208185196,
      "sparse_tokens": 32089.0,
      "step": 7626,
      "turn_loss": 0.07289771735668182,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26848.0,
      "epoch": 0.3543486340828842,
      "grad_norm": 0.5999951362609863,
      "learning_rate": 2.9880820726046613e-06,
      "loss": 0.1562,
      "mae_dtheta": 0.02769503742456436,
      "mae_dx": 0.00982742104679346,
      "mae_dy": 0.0036805416457355022,
      "pose_mae_dtheta": 0.23535218834877014,
      "pose_mae_dx": 0.07838281989097595,
      "pose_mae_dy": 0.0454753153026104,
      "pose_rmse_dtheta": 0.45908692479133606,
      "pose_rmse_dx": 0.19262559711933136,
      "pose_rmse_dy": 0.1087067499756813,
      "pose_rmse_mean": 0.25347310304641724,
      "rmse_dtheta": 0.046318549662828445,
      "rmse_dx": 0.022044921293854713,
      "rmse_dy": 0.008210225030779839,
      "rmse_mean": 0.025524567812681198,
      "rotation_flip": 0.00805729627609253,
      "sparse_tokens": 22852.0,
      "step": 7627,
      "turn_loss": 0.21015006303787231,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.354395093848727,
      "grad_norm": 0.9987888336181641,
      "learning_rate": 2.9868716894811713e-06,
      "loss": 0.2108,
      "mae_dtheta": 0.0422065444290638,
      "mae_dx": 0.015326348133385181,
      "mae_dy": 0.005798871163278818,
      "pose_mae_dtheta": 0.3839717507362366,
      "pose_mae_dx": 0.12012999504804611,
      "pose_mae_dy": 0.06374957412481308,
      "pose_rmse_dtheta": 0.5915274024009705,
      "pose_rmse_dx": 0.24457000195980072,
      "pose_rmse_dy": 0.15590150654315948,
      "pose_rmse_mean": 0.33066630363464355,
      "rmse_dtheta": 0.059788040816783905,
      "rmse_dx": 0.027636634185910225,
      "rmse_dy": 0.012735149823129177,
      "rmse_mean": 0.03338661044836044,
      "rotation_flip": 0.02576112374663353,
      "sparse_tokens": 7549.0,
      "step": 7628,
      "turn_loss": 0.3132057189941406,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 2302.0,
      "epoch": 0.3544415536145698,
      "grad_norm": 0.35428181290626526,
      "learning_rate": 2.985661447136823e-06,
      "loss": 0.0824,
      "mae_dtheta": 0.03201362490653992,
      "mae_dx": 0.015732083469629288,
      "mae_dy": 0.013717366382479668,
      "pose_mae_dtheta": 0.21951785683631897,
      "pose_mae_dx": 0.07151723653078079,
      "pose_mae_dy": 0.15068019926548004,
      "pose_rmse_dtheta": 0.341200590133667,
      "pose_rmse_dx": 0.09554924815893173,
      "pose_rmse_dy": 0.24591504037380219,
      "pose_rmse_mean": 0.22755496203899384,
      "rmse_dtheta": 0.0411636158823967,
      "rmse_dx": 0.02638225443661213,
      "rmse_dy": 0.018106352537870407,
      "rmse_mean": 0.02855074033141136,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 2042.0,
      "step": 7629,
      "turn_loss": 0.4570867717266083,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.3544880133804126,
      "grad_norm": 0.5383774042129517,
      "learning_rate": 2.984451345656252e-06,
      "loss": 0.1308,
      "mae_dtheta": 0.03110012784600258,
      "mae_dx": 0.012035822495818138,
      "mae_dy": 0.006423169281333685,
      "pose_mae_dtheta": 0.248407244682312,
      "pose_mae_dx": 0.09348509460687637,
      "pose_mae_dy": 0.0662599727511406,
      "pose_rmse_dtheta": 0.4132510721683502,
      "pose_rmse_dx": 0.1906810998916626,
      "pose_rmse_dy": 0.15501892566680908,
      "pose_rmse_mean": 0.2529836893081665,
      "rmse_dtheta": 0.0474943071603775,
      "rmse_dx": 0.023481719195842743,
      "rmse_dy": 0.016011638566851616,
      "rmse_mean": 0.02899589017033577,
      "rotation_flip": 0.014124293811619282,
      "sparse_tokens": 12572.0,
      "step": 7630,
      "turn_loss": 0.3113155663013458,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35453447314625536,
      "grad_norm": 0.6943721771240234,
      "learning_rate": 2.9832413851240803e-06,
      "loss": 0.1895,
      "mae_dtheta": 0.010030435398221016,
      "mae_dx": 0.002434453694149852,
      "mae_dy": 0.0026500935200601816,
      "pose_mae_dtheta": 0.06885097175836563,
      "pose_mae_dx": 0.022554047405719757,
      "pose_mae_dy": 0.023788776248693466,
      "pose_rmse_dtheta": 0.19200435280799866,
      "pose_rmse_dx": 0.06591829657554626,
      "pose_rmse_dy": 0.06594157963991165,
      "pose_rmse_mean": 0.10795474052429199,
      "rmse_dtheta": 0.024416744709014893,
      "rmse_dx": 0.008503390476107597,
      "rmse_dy": 0.007597661577165127,
      "rmse_mean": 0.013505933806300163,
      "rotation_flip": 0.007187350187450647,
      "sparse_tokens": 32089.0,
      "step": 7631,
      "turn_loss": 0.1044638454914093,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.35458093291209813,
      "grad_norm": 0.4452242851257324,
      "learning_rate": 2.9820315656249206e-06,
      "loss": 0.1287,
      "mae_dtheta": 0.010412611067295074,
      "mae_dx": 0.0015250052092596889,
      "mae_dy": 0.003046194324269891,
      "pose_mae_dtheta": 0.07299618422985077,
      "pose_mae_dx": 0.024229828268289566,
      "pose_mae_dy": 0.030232492834329605,
      "pose_rmse_dtheta": 0.17563322186470032,
      "pose_rmse_dx": 0.0724952295422554,
      "pose_rmse_dy": 0.07180558145046234,
      "pose_rmse_mean": 0.10664467513561249,
      "rmse_dtheta": 0.02285727486014366,
      "rmse_dx": 0.004600844345986843,
      "rmse_dy": 0.007242058403789997,
      "rmse_mean": 0.011566726490855217,
      "rotation_flip": 0.003828158136457205,
      "sparse_tokens": 32057.0,
      "step": 7632,
      "turn_loss": 0.08563295751810074,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10054.0,
      "epoch": 0.3546273926779409,
      "grad_norm": 0.4589553475379944,
      "learning_rate": 2.980821887243377e-06,
      "loss": 0.1189,
      "mae_dtheta": 0.04541861638426781,
      "mae_dx": 0.013338327407836914,
      "mae_dy": 0.009636657312512398,
      "pose_mae_dtheta": 0.373656302690506,
      "pose_mae_dx": 0.11670970171689987,
      "pose_mae_dy": 0.1163947656750679,
      "pose_rmse_dtheta": 0.6430802345275879,
      "pose_rmse_dx": 0.24675527215003967,
      "pose_rmse_dy": 0.2663775384426117,
      "pose_rmse_mean": 0.3854043483734131,
      "rmse_dtheta": 0.06536103785037994,
      "rmse_dx": 0.025279361754655838,
      "rmse_dy": 0.01848706044256687,
      "rmse_mean": 0.03637582063674927,
      "rotation_flip": 0.014000000432133675,
      "sparse_tokens": 8380.0,
      "step": 7633,
      "turn_loss": 0.3085556626319885,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 63871.0,
      "epoch": 0.3546738524437837,
      "grad_norm": 0.3860948979854584,
      "learning_rate": 2.9796123500640424e-06,
      "loss": 0.0752,
      "mae_dtheta": 0.00964505597949028,
      "mae_dx": 0.001617531175725162,
      "mae_dy": 0.0020282543264329433,
      "pose_mae_dtheta": 0.06593061983585358,
      "pose_mae_dx": 0.017876125872135162,
      "pose_mae_dy": 0.026917967945337296,
      "pose_rmse_dtheta": 0.17494064569473267,
      "pose_rmse_dx": 0.046352386474609375,
      "pose_rmse_dy": 0.07991060614585876,
      "pose_rmse_mean": 0.10040121525526047,
      "rmse_dtheta": 0.023121817037463188,
      "rmse_dx": 0.00482037290930748,
      "rmse_dy": 0.005340555217117071,
      "rmse_mean": 0.011094248853623867,
      "rotation_flip": 0.004981884267181158,
      "sparse_tokens": 32071.0,
      "step": 7634,
      "turn_loss": 0.08400663733482361,
      "turns": 196.0,
      "turns_per_sample": 196.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.35472031220962646,
      "grad_norm": 0.42042773962020874,
      "learning_rate": 2.9784029541715005e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.010388790629804134,
      "mae_dx": 0.0024789152666926384,
      "mae_dy": 0.0022949816193431616,
      "pose_mae_dtheta": 0.07332707196474075,
      "pose_mae_dx": 0.03389616310596466,
      "pose_mae_dy": 0.031941208988428116,
      "pose_rmse_dtheta": 0.1989014893770218,
      "pose_rmse_dx": 0.08730445802211761,
      "pose_rmse_dy": 0.08226160705089569,
      "pose_rmse_mean": 0.12282252311706543,
      "rmse_dtheta": 0.024087756872177124,
      "rmse_dx": 0.008321707136929035,
      "rmse_dy": 0.005458088591694832,
      "rmse_mean": 0.012622518464922905,
      "rotation_flip": 0.004459861200302839,
      "sparse_tokens": 32057.0,
      "step": 7635,
      "turn_loss": 0.1008610650897026,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.35476677197546924,
      "grad_norm": 0.6120557188987732,
      "learning_rate": 2.977193699650325e-06,
      "loss": 0.1155,
      "mae_dtheta": 0.03502003103494644,
      "mae_dx": 0.009742466732859612,
      "mae_dy": 0.004744450096040964,
      "pose_mae_dtheta": 0.24514876306056976,
      "pose_mae_dx": 0.08233902603387833,
      "pose_mae_dy": 0.04515424743294716,
      "pose_rmse_dtheta": 0.46054428815841675,
      "pose_rmse_dx": 0.22301678359508514,
      "pose_rmse_dy": 0.09946602582931519,
      "pose_rmse_mean": 0.2610090374946594,
      "rmse_dtheta": 0.053737081587314606,
      "rmse_dx": 0.02230675145983696,
      "rmse_dy": 0.008142909966409206,
      "rmse_mean": 0.02806224673986435,
      "rotation_flip": 0.011705685406923294,
      "sparse_tokens": 9590.0,
      "step": 7636,
      "turn_loss": 0.2273443341255188,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.354813231741312,
      "grad_norm": 0.4470498561859131,
      "learning_rate": 2.975984586585079e-06,
      "loss": 0.1216,
      "mae_dtheta": 0.01162402518093586,
      "mae_dx": 0.002683923114091158,
      "mae_dy": 0.003330867737531662,
      "pose_mae_dtheta": 0.07692623883485794,
      "pose_mae_dx": 0.031571805477142334,
      "pose_mae_dy": 0.031078744679689407,
      "pose_rmse_dtheta": 0.17909035086631775,
      "pose_rmse_dx": 0.0723680853843689,
      "pose_rmse_dy": 0.06446599960327148,
      "pose_rmse_mean": 0.10530814528465271,
      "rmse_dtheta": 0.024140119552612305,
      "rmse_dx": 0.006355518475174904,
      "rmse_dy": 0.006749382242560387,
      "rmse_mean": 0.012415006756782532,
      "rotation_flip": 0.006535947788506746,
      "sparse_tokens": 32185.0,
      "step": 7637,
      "turn_loss": 0.1246841698884964,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3548596915071548,
      "grad_norm": 0.367108017206192,
      "learning_rate": 2.974775615060319e-06,
      "loss": 0.0755,
      "mae_dtheta": 0.009358149021863937,
      "mae_dx": 0.0018017932306975126,
      "mae_dy": 0.0018463184824213386,
      "pose_mae_dtheta": 0.06603745371103287,
      "pose_mae_dx": 0.019643988460302353,
      "pose_mae_dy": 0.020933177322149277,
      "pose_rmse_dtheta": 0.18349306285381317,
      "pose_rmse_dx": 0.06078718602657318,
      "pose_rmse_dy": 0.06500467658042908,
      "pose_rmse_mean": 0.10309498012065887,
      "rmse_dtheta": 0.023401495069265366,
      "rmse_dx": 0.0059193032793700695,
      "rmse_dy": 0.004955609794706106,
      "rmse_mean": 0.011425469070672989,
      "rotation_flip": 0.00592592591419816,
      "sparse_tokens": 32089.0,
      "step": 7638,
      "turn_loss": 0.06982302665710449,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.35490615127299757,
      "grad_norm": 0.7280767560005188,
      "learning_rate": 2.9735667851605855e-06,
      "loss": 0.1726,
      "mae_dtheta": 0.0353773832321167,
      "mae_dx": 0.013896966353058815,
      "mae_dy": 0.003735008416697383,
      "pose_mae_dtheta": 0.2864078879356384,
      "pose_mae_dx": 0.11059854924678802,
      "pose_mae_dy": 0.035706743597984314,
      "pose_rmse_dtheta": 0.5174973011016846,
      "pose_rmse_dx": 0.23642568290233612,
      "pose_rmse_dy": 0.09633185714483261,
      "pose_rmse_mean": 0.28341829776763916,
      "rmse_dtheta": 0.05566093325614929,
      "rmse_dx": 0.02636074833571911,
      "rmse_dy": 0.008262797258794308,
      "rmse_mean": 0.030094828456640244,
      "rotation_flip": 0.011514614336192608,
      "sparse_tokens": 20250.0,
      "step": 7639,
      "turn_loss": 0.26999035477638245,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.35495261103884035,
      "grad_norm": 0.8980430960655212,
      "learning_rate": 2.972358096970416e-06,
      "loss": 0.236,
      "mae_dtheta": 0.03798682987689972,
      "mae_dx": 0.011768375523388386,
      "mae_dy": 0.0028548960108309984,
      "pose_mae_dtheta": 0.3161675035953522,
      "pose_mae_dx": 0.09796793013811111,
      "pose_mae_dy": 0.03679521009325981,
      "pose_rmse_dtheta": 0.5401629209518433,
      "pose_rmse_dx": 0.21846061944961548,
      "pose_rmse_dy": 0.08509339392185211,
      "pose_rmse_mean": 0.28123897314071655,
      "rmse_dtheta": 0.05750236287713051,
      "rmse_dx": 0.02365708164870739,
      "rmse_dy": 0.005784168839454651,
      "rmse_mean": 0.028981205075979233,
      "rotation_flip": 0.008356546051800251,
      "sparse_tokens": 18028.0,
      "step": 7640,
      "turn_loss": 0.24210570752620697,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.3549990708046831,
      "grad_norm": 0.5253000855445862,
      "learning_rate": 2.9711495505743317e-06,
      "loss": 0.1124,
      "mae_dtheta": 0.020987769588828087,
      "mae_dx": 0.011415059678256512,
      "mae_dy": 0.005560328718274832,
      "pose_mae_dtheta": 0.14378303289413452,
      "pose_mae_dx": 0.09006109088659286,
      "pose_mae_dy": 0.09119667112827301,
      "pose_rmse_dtheta": 0.24681565165519714,
      "pose_rmse_dx": 0.23442472517490387,
      "pose_rmse_dy": 0.18964536488056183,
      "pose_rmse_mean": 0.22362858057022095,
      "rmse_dtheta": 0.032836053520441055,
      "rmse_dx": 0.026329385116696358,
      "rmse_dy": 0.009239918552339077,
      "rmse_mean": 0.02280178666114807,
      "rotation_flip": 0.022151898592710495,
      "sparse_tokens": 7033.0,
      "step": 7641,
      "turn_loss": 0.18833273649215698,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3550455305705259,
      "grad_norm": 0.291691392660141,
      "learning_rate": 2.969941146056848e-06,
      "loss": 0.0656,
      "mae_dtheta": 0.00922801811248064,
      "mae_dx": 0.0017003495013341308,
      "mae_dy": 0.0012672912562265992,
      "pose_mae_dtheta": 0.06892703473567963,
      "pose_mae_dx": 0.020033370703458786,
      "pose_mae_dy": 0.017308946698904037,
      "pose_rmse_dtheta": 0.23152939975261688,
      "pose_rmse_dx": 0.05101590231060982,
      "pose_rmse_dy": 0.04868268966674805,
      "pose_rmse_mean": 0.11040933430194855,
      "rmse_dtheta": 0.025303920730948448,
      "rmse_dx": 0.0053739408031105995,
      "rmse_dy": 0.0031793583184480667,
      "rmse_mean": 0.011285739950835705,
      "rotation_flip": 0.0014238253934308887,
      "sparse_tokens": 32169.0,
      "step": 7642,
      "turn_loss": 0.05305466428399086,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17859.0,
      "epoch": 0.3550919903363687,
      "grad_norm": 1.2503865957260132,
      "learning_rate": 2.968732883502471e-06,
      "loss": 0.2592,
      "mae_dtheta": 0.0226135216653347,
      "mae_dx": 0.00882257055491209,
      "mae_dy": 0.003878789721056819,
      "pose_mae_dtheta": 0.14379754662513733,
      "pose_mae_dx": 0.05966859310865402,
      "pose_mae_dy": 0.04301068186759949,
      "pose_rmse_dtheta": 0.2889111638069153,
      "pose_rmse_dx": 0.14943623542785645,
      "pose_rmse_dy": 0.11198575794696808,
      "pose_rmse_mean": 0.18344438076019287,
      "rmse_dtheta": 0.0378694124519825,
      "rmse_dx": 0.020052632316946983,
      "rmse_dy": 0.00975721888244152,
      "rmse_mean": 0.022559754550457,
      "rotation_flip": 0.012578615918755531,
      "sparse_tokens": 14285.0,
      "step": 7643,
      "turn_loss": 0.16948138177394867,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.3551384501022115,
      "grad_norm": 0.627617597579956,
      "learning_rate": 2.9675247629956925e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.030188750475645065,
      "mae_dx": 0.014563290402293205,
      "mae_dy": 0.006055778823792934,
      "pose_mae_dtheta": 0.2103564590215683,
      "pose_mae_dx": 0.12437668442726135,
      "pose_mae_dy": 0.07532458752393723,
      "pose_rmse_dtheta": 0.3780609667301178,
      "pose_rmse_dx": 0.30111852288246155,
      "pose_rmse_dy": 0.1569393277168274,
      "pose_rmse_mean": 0.27870628237724304,
      "rmse_dtheta": 0.04761819541454315,
      "rmse_dx": 0.029427018016576767,
      "rmse_dy": 0.01072506420314312,
      "rmse_mean": 0.029256761074066162,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 5089.0,
      "step": 7644,
      "turn_loss": 0.2213812619447708,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 39143.0,
      "epoch": 0.3551849098680543,
      "grad_norm": 0.4432469308376312,
      "learning_rate": 2.966316784621e-06,
      "loss": 0.1505,
      "mae_dtheta": 0.03439171984791756,
      "mae_dx": 0.012864281423389912,
      "mae_dy": 0.005010783206671476,
      "pose_mae_dtheta": 0.2637806832790375,
      "pose_mae_dx": 0.10678070038557053,
      "pose_mae_dy": 0.053437765687704086,
      "pose_rmse_dtheta": 0.49978768825531006,
      "pose_rmse_dx": 0.23306488990783691,
      "pose_rmse_dy": 0.1280919909477234,
      "pose_rmse_mean": 0.2869815230369568,
      "rmse_dtheta": 0.05400741100311279,
      "rmse_dx": 0.026001987978816032,
      "rmse_dy": 0.010549456812441349,
      "rmse_mean": 0.030186286196112633,
      "rotation_flip": 0.009038088843226433,
      "sparse_tokens": 29202.0,
      "step": 7645,
      "turn_loss": 0.2443135529756546,
      "turns": 121.0,
      "turns_per_sample": 121.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35523136963389706,
      "grad_norm": 0.40531256794929504,
      "learning_rate": 2.965108948462864e-06,
      "loss": 0.083,
      "mae_dtheta": 0.009182996116578579,
      "mae_dx": 0.001290281186811626,
      "mae_dy": 0.0025148752611130476,
      "pose_mae_dtheta": 0.06415858119726181,
      "pose_mae_dx": 0.023971671238541603,
      "pose_mae_dy": 0.02852693758904934,
      "pose_rmse_dtheta": 0.15760771930217743,
      "pose_rmse_dx": 0.062203213572502136,
      "pose_rmse_dy": 0.07032960653305054,
      "pose_rmse_mean": 0.09671351313591003,
      "rmse_dtheta": 0.020439960062503815,
      "rmse_dx": 0.0034658443182706833,
      "rmse_dy": 0.005038863513618708,
      "rmse_mean": 0.009648222476243973,
      "rotation_flip": 0.0041928719729185104,
      "sparse_tokens": 32089.0,
      "step": 7646,
      "turn_loss": 0.07034613192081451,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.35527782939973984,
      "grad_norm": 0.8009429574012756,
      "learning_rate": 2.9639012546057537e-06,
      "loss": 0.1612,
      "mae_dtheta": 0.012251058593392372,
      "mae_dx": 0.0025915654841810465,
      "mae_dy": 0.001958440989255905,
      "pose_mae_dtheta": 0.0898435041308403,
      "pose_mae_dx": 0.01955150067806244,
      "pose_mae_dy": 0.015591751784086227,
      "pose_rmse_dtheta": 0.3048349618911743,
      "pose_rmse_dx": 0.048703208565711975,
      "pose_rmse_dy": 0.048337437212467194,
      "pose_rmse_mean": 0.13395853340625763,
      "rmse_dtheta": 0.03411487489938736,
      "rmse_dx": 0.00719499122351408,
      "rmse_dy": 0.007228713948279619,
      "rmse_mean": 0.016179528087377548,
      "rotation_flip": 0.0028935184236615896,
      "sparse_tokens": 32185.0,
      "step": 7647,
      "turn_loss": 0.12484224140644073,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3553242891655826,
      "grad_norm": 0.36298322677612305,
      "learning_rate": 2.9626937031341198e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.009555704891681671,
      "mae_dx": 0.0012649254640564322,
      "mae_dy": 0.002321094274520874,
      "pose_mae_dtheta": 0.052342914044857025,
      "pose_mae_dx": 0.016478760167956352,
      "pose_mae_dy": 0.025561699643731117,
      "pose_rmse_dtheta": 0.13159775733947754,
      "pose_rmse_dx": 0.04246228188276291,
      "pose_rmse_dy": 0.06286843866109848,
      "pose_rmse_mean": 0.07897616922855377,
      "rmse_dtheta": 0.022216206416487694,
      "rmse_dx": 0.003946871496737003,
      "rmse_dy": 0.005989708472043276,
      "rmse_mean": 0.010717595927417278,
      "rotation_flip": 0.007544322870671749,
      "sparse_tokens": 32105.0,
      "step": 7648,
      "turn_loss": 0.08463442325592041,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3553707489314254,
      "grad_norm": 0.720258891582489,
      "learning_rate": 2.961486294132409e-06,
      "loss": 0.1903,
      "mae_dtheta": 0.011943647637963295,
      "mae_dx": 0.001736470963805914,
      "mae_dy": 0.00236851186491549,
      "pose_mae_dtheta": 0.07578371465206146,
      "pose_mae_dx": 0.020548086613416672,
      "pose_mae_dy": 0.02635475993156433,
      "pose_rmse_dtheta": 0.22431746125221252,
      "pose_rmse_dx": 0.04630633443593979,
      "pose_rmse_dy": 0.05927122011780739,
      "pose_rmse_mean": 0.1099650114774704,
      "rmse_dtheta": 0.02811390906572342,
      "rmse_dx": 0.006453261710703373,
      "rmse_dy": 0.005992987658828497,
      "rmse_mean": 0.013520052656531334,
      "rotation_flip": 0.0024288687855005264,
      "sparse_tokens": 32169.0,
      "step": 7649,
      "turn_loss": 0.09620475023984909,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.35541720869726817,
      "grad_norm": 0.3170335292816162,
      "learning_rate": 2.9602790276850562e-06,
      "loss": 0.0909,
      "mae_dtheta": 0.033988263458013535,
      "mae_dx": 0.007774426136165857,
      "mae_dy": 0.005515578668564558,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.317033588886261,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 144.34559631347656,
      "model/head/act_norm_mean": 104.27783203125,
      "model/head/act_norm_min": 76.04557800292969,
      "model/head/act_over_embed": 71.66070243631978,
      "model/head/grad_frac": 0.1299085170030594,
      "model/head/grad_norm": 0.04118536412715912,
      "model/head/grad_zero_frac": 0.00020495755597949028,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6923384232954546,
      "model/head/update_ratio": 0.0007019573822617531,
      "model/head/weight_delta": 9.591792106628418,
      "model/head/weight_delta_rel": 0.16826844215393066,
      "model/head/weight_norm": 58.67217254638672,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4222433567047119,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4221909149833348,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42212769389152527,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29013354939016817,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11866916716098785,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0376221127808094,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5505264945652174,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012150987749919295,
      "model/modality_embedder.encoders.pose/weight_delta": 3.073225975036621,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10041186958551407,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96218490600586,
      "model/modality_embedder/grad_frac": 0.11866916716098785,
      "model/modality_embedder/grad_norm": 0.0376221127808094,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5505264945652174,
      "model/modality_embedder/update_ratio": 0.0012150987749919295,
      "model/modality_embedder/weight_delta": 3.073225975036621,
      "model/modality_embedder/weight_delta_rel": 0.10041186958551407,
      "model/modality_embedder/weight_norm": 30.96218490600586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.61543273925781,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.153962899080085,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.526721954345703,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.911620075063775,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1026851236820221,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03255463391542435,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011660561431199312,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5507214069366455,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09294982999563217,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.918582916259766,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.21561431884766,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.994340728715727,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.74691104888916,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.489135587330587,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09808608889579773,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03109658509492874,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010469276458024979,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.236382484436035,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11211081594228745,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.70270538330078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.1134262084961,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.597794349747474,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.956754684448242,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.59104392747292,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09669318050146103,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030654985457658768,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009995352011173964,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.495967388153076,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1173880398273468,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.669240951538086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.03865814208984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.446947150072152,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.970667839050293,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.86179904389731,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09763623774051666,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.030953966081142426,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010353001998737454,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.9935083389282227,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10230390727519989,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.898542404174805,
      "model/normalizer/grad_frac": 0.36930689215660095,
      "model/normalizer/grad_norm": 0.11708269268274307,
      "model/normalizer/grad_zero_frac": 0.0002481650735717267,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014899609377607703,
      "model/normalizer/weight_delta": 6.321332931518555,
      "model/normalizer/weight_delta_rel": 0.08141510933637619,
      "model/normalizer/weight_norm": 78.58104705810547,
      "pose_mae_dtheta": 0.21254582703113556,
      "pose_mae_dx": 0.05293602868914604,
      "pose_mae_dy": 0.04200225695967674,
      "pose_rmse_dtheta": 0.4503573775291443,
      "pose_rmse_dx": 0.12339945882558823,
      "pose_rmse_dy": 0.09323019534349442,
      "pose_rmse_mean": 0.2223290055990219,
      "rmse_dtheta": 0.056990355253219604,
      "rmse_dx": 0.01829279027879238,
      "rmse_dy": 0.012644805014133453,
      "rmse_mean": 0.029309317469596863,
      "rotation_flip": 0.006172839552164078,
      "sparse_tokens": 6153.0,
      "step": 7650,
      "turn_loss": 0.2411823719739914,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.35546366846311095,
      "grad_norm": 0.46709805727005005,
      "learning_rate": 2.959071903876486e-06,
      "loss": 0.0852,
      "mae_dtheta": 0.03752503916621208,
      "mae_dx": 0.012971574440598488,
      "mae_dy": 0.00585017679259181,
      "pose_mae_dtheta": 0.3555428087711334,
      "pose_mae_dx": 0.09143442660570145,
      "pose_mae_dy": 0.0719386637210846,
      "pose_rmse_dtheta": 0.6083537936210632,
      "pose_rmse_dx": 0.18641051650047302,
      "pose_rmse_dy": 0.17225264012813568,
      "pose_rmse_mean": 0.3223389983177185,
      "rmse_dtheta": 0.05651966854929924,
      "rmse_dx": 0.02585146203637123,
      "rmse_dy": 0.010775724425911903,
      "rmse_mean": 0.031048951670527458,
      "rotation_flip": 0.01104972418397665,
      "sparse_tokens": 6131.0,
      "step": 7651,
      "turn_loss": 0.23362822830677032,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3555101282289537,
      "grad_norm": 0.34816911816596985,
      "learning_rate": 2.957864922791113e-06,
      "loss": 0.1019,
      "mae_dtheta": 0.0077450573444366455,
      "mae_dx": 0.0014910338213667274,
      "mae_dy": 0.0013363900361582637,
      "pose_mae_dtheta": 0.060499001294374466,
      "pose_mae_dx": 0.014338869601488113,
      "pose_mae_dy": 0.01473144255578518,
      "pose_rmse_dtheta": 0.19596654176712036,
      "pose_rmse_dx": 0.04051356390118599,
      "pose_rmse_dy": 0.03643966093659401,
      "pose_rmse_mean": 0.09097325801849365,
      "rmse_dtheta": 0.0226846095174551,
      "rmse_dx": 0.004879135638475418,
      "rmse_dy": 0.004683624487370253,
      "rmse_mean": 0.010749123059213161,
      "rotation_flip": 0.0026408450212329626,
      "sparse_tokens": 32153.0,
      "step": 7652,
      "turn_loss": 0.054533928632736206,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3555565879947965,
      "grad_norm": 0.7295648455619812,
      "learning_rate": 2.9566580845133413e-06,
      "loss": 0.1605,
      "mae_dtheta": 0.010716727934777737,
      "mae_dx": 0.002226464916020632,
      "mae_dy": 0.002780948067083955,
      "pose_mae_dtheta": 0.0760582759976387,
      "pose_mae_dx": 0.02881508320569992,
      "pose_mae_dy": 0.03072730451822281,
      "pose_rmse_dtheta": 0.19520272314548492,
      "pose_rmse_dx": 0.06900951266288757,
      "pose_rmse_dy": 0.072424978017807,
      "pose_rmse_mean": 0.1122124120593071,
      "rmse_dtheta": 0.024119284003973007,
      "rmse_dx": 0.0058316560462117195,
      "rmse_dy": 0.006348529830574989,
      "rmse_mean": 0.012099822983145714,
      "rotation_flip": 0.007476635742932558,
      "sparse_tokens": 32185.0,
      "step": 7653,
      "turn_loss": 0.089781753718853,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3556030477606393,
      "grad_norm": 0.7027004957199097,
      "learning_rate": 2.955451389127567e-06,
      "loss": 0.1212,
      "mae_dtheta": 0.00854593887925148,
      "mae_dx": 0.0014728247188031673,
      "mae_dy": 0.0020175878889858723,
      "pose_mae_dtheta": 0.057656075805425644,
      "pose_mae_dx": 0.01586470566689968,
      "pose_mae_dy": 0.024600893259048462,
      "pose_rmse_dtheta": 0.1677817404270172,
      "pose_rmse_dx": 0.04273134469985962,
      "pose_rmse_dy": 0.06658525764942169,
      "pose_rmse_mean": 0.09236612170934677,
      "rmse_dtheta": 0.02160530909895897,
      "rmse_dx": 0.004722535144537687,
      "rmse_dy": 0.005703856702893972,
      "rmse_mean": 0.010677233338356018,
      "rotation_flip": 0.0005583472666330636,
      "sparse_tokens": 32057.0,
      "step": 7654,
      "turn_loss": 0.06631822139024734,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.35564950752648206,
      "grad_norm": 1.2508758306503296,
      "learning_rate": 2.9542448367181743e-06,
      "loss": 0.2992,
      "mae_dtheta": 0.042317211627960205,
      "mae_dx": 0.01843876577913761,
      "mae_dy": 0.007289211731404066,
      "pose_mae_dtheta": 0.31204381585121155,
      "pose_mae_dx": 0.15268076956272125,
      "pose_mae_dy": 0.09149523824453354,
      "pose_rmse_dtheta": 0.5728179812431335,
      "pose_rmse_dx": 0.2814658284187317,
      "pose_rmse_dy": 0.18148952722549438,
      "pose_rmse_mean": 0.3452577590942383,
      "rmse_dtheta": 0.06050598993897438,
      "rmse_dx": 0.031778354197740555,
      "rmse_dy": 0.012274247594177723,
      "rmse_mean": 0.03485286608338356,
      "rotation_flip": 0.008196720853447914,
      "sparse_tokens": 3924.0,
      "step": 7655,
      "turn_loss": 0.28453654050827026,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35569596729232483,
      "grad_norm": 0.39504870772361755,
      "learning_rate": 2.9530384273695373e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.009836377575993538,
      "mae_dx": 0.0019732858054339886,
      "mae_dy": 0.002636468969285488,
      "pose_mae_dtheta": 0.0656624436378479,
      "pose_mae_dx": 0.02203550562262535,
      "pose_mae_dy": 0.030031146481633186,
      "pose_rmse_dtheta": 0.15986211597919464,
      "pose_rmse_dx": 0.0623198039829731,
      "pose_rmse_dy": 0.07357387989759445,
      "pose_rmse_mean": 0.09858527034521103,
      "rmse_dtheta": 0.02125072292983532,
      "rmse_dx": 0.00614778371527791,
      "rmse_dy": 0.005898007657378912,
      "rmse_mean": 0.011098838411271572,
      "rotation_flip": 0.007455731742084026,
      "sparse_tokens": 32089.0,
      "step": 7656,
      "turn_loss": 0.09414133429527283,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3557424270581676,
      "grad_norm": 0.5504773259162903,
      "learning_rate": 2.951832161166024e-06,
      "loss": 0.1074,
      "mae_dtheta": 0.008120618760585785,
      "mae_dx": 0.0012141510378569365,
      "mae_dy": 0.0016025847289711237,
      "pose_mae_dtheta": 0.048286113888025284,
      "pose_mae_dx": 0.01564597710967064,
      "pose_mae_dy": 0.023116150870919228,
      "pose_rmse_dtheta": 0.09167197346687317,
      "pose_rmse_dx": 0.037761952728033066,
      "pose_rmse_dy": 0.052763666957616806,
      "pose_rmse_mean": 0.060732536017894745,
      "rmse_dtheta": 0.016224581748247147,
      "rmse_dx": 0.003747230162844062,
      "rmse_dy": 0.003065909957513213,
      "rmse_mean": 0.00767924077808857,
      "rotation_flip": 0.003789314068853855,
      "sparse_tokens": 32105.0,
      "step": 7657,
      "turn_loss": 0.06637708097696304,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3557888868240104,
      "grad_norm": 0.49561962485313416,
      "learning_rate": 2.950626038191985e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.010635033249855042,
      "mae_dx": 0.0017060298705473542,
      "mae_dy": 0.0018486203625798225,
      "pose_mae_dtheta": 0.07161521911621094,
      "pose_mae_dx": 0.02081141248345375,
      "pose_mae_dy": 0.02213042601943016,
      "pose_rmse_dtheta": 0.18851053714752197,
      "pose_rmse_dx": 0.05152992904186249,
      "pose_rmse_dy": 0.05097172036767006,
      "pose_rmse_mean": 0.09700407087802887,
      "rmse_dtheta": 0.023772941902279854,
      "rmse_dx": 0.005104352254420519,
      "rmse_dy": 0.0044764685444533825,
      "rmse_mean": 0.011117920279502869,
      "rotation_flip": 0.001957713393494487,
      "sparse_tokens": 32153.0,
      "step": 7658,
      "turn_loss": 0.07045940309762955,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22005.0,
      "epoch": 0.35583534658985316,
      "grad_norm": 0.5764132738113403,
      "learning_rate": 2.9494200585317683e-06,
      "loss": 0.1535,
      "mae_dtheta": 0.03283628448843956,
      "mae_dx": 0.016455385833978653,
      "mae_dy": 0.008407938294112682,
      "pose_mae_dtheta": 0.26740288734436035,
      "pose_mae_dx": 0.12909822165966034,
      "pose_mae_dy": 0.09929543733596802,
      "pose_rmse_dtheta": 0.4486098289489746,
      "pose_rmse_dx": 0.24360866844654083,
      "pose_rmse_dy": 0.2562822103500366,
      "pose_rmse_mean": 0.3161669075489044,
      "rmse_dtheta": 0.0487225241959095,
      "rmse_dx": 0.028555376455187798,
      "rmse_dy": 0.019464978948235512,
      "rmse_mean": 0.032247625291347504,
      "rotation_flip": 0.011428571306169033,
      "sparse_tokens": 18194.0,
      "step": 7659,
      "turn_loss": 0.3551538586616516,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 7815.0,
      "epoch": 0.35588180635569594,
      "grad_norm": 0.5950542092323303,
      "learning_rate": 2.9482142222697064e-06,
      "loss": 0.1308,
      "mae_dtheta": 0.014496905729174614,
      "mae_dx": 0.009592299349606037,
      "mae_dy": 0.0021802587434649467,
      "pose_mae_dtheta": 0.12035024166107178,
      "pose_mae_dx": 0.05792573094367981,
      "pose_mae_dy": 0.04010603576898575,
      "pose_rmse_dtheta": 0.2666105329990387,
      "pose_rmse_dx": 0.17509932816028595,
      "pose_rmse_dy": 0.1064983382821083,
      "pose_rmse_mean": 0.1827360838651657,
      "rmse_dtheta": 0.028971154242753983,
      "rmse_dx": 0.02354700304567814,
      "rmse_dy": 0.004716221708804369,
      "rmse_mean": 0.019078128039836884,
      "rotation_flip": 0.007407407276332378,
      "sparse_tokens": 6250.0,
      "step": 7660,
      "turn_loss": 0.1521146446466446,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35592826612153877,
      "grad_norm": 0.6015064716339111,
      "learning_rate": 2.9470085294901244e-06,
      "loss": 0.1314,
      "mae_dtheta": 0.010377672500908375,
      "mae_dx": 0.0028466181829571724,
      "mae_dy": 0.0034550039563328028,
      "pose_mae_dtheta": 0.07601096481084824,
      "pose_mae_dx": 0.029765723273158073,
      "pose_mae_dy": 0.027110788971185684,
      "pose_rmse_dtheta": 0.20610447227954865,
      "pose_rmse_dx": 0.08345817029476166,
      "pose_rmse_dy": 0.07060829550027847,
      "pose_rmse_mean": 0.12005697935819626,
      "rmse_dtheta": 0.024071458727121353,
      "rmse_dx": 0.008962280116975307,
      "rmse_dy": 0.008781270124018192,
      "rmse_mean": 0.01393833663314581,
      "rotation_flip": 0.002816901309415698,
      "sparse_tokens": 32089.0,
      "step": 7661,
      "turn_loss": 0.1133948266506195,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.35597472588738155,
      "grad_norm": 0.5056293606758118,
      "learning_rate": 2.9458029802773402e-06,
      "loss": 0.1501,
      "mae_dtheta": 0.022892719134688377,
      "mae_dx": 0.006521330680698156,
      "mae_dy": 0.004939655773341656,
      "pose_mae_dtheta": 0.17453157901763916,
      "pose_mae_dx": 0.06034790724515915,
      "pose_mae_dy": 0.07263130694627762,
      "pose_rmse_dtheta": 0.32262396812438965,
      "pose_rmse_dx": 0.16203178465366364,
      "pose_rmse_dy": 0.15104392170906067,
      "pose_rmse_mean": 0.21189987659454346,
      "rmse_dtheta": 0.038971856236457825,
      "rmse_dx": 0.018440766260027885,
      "rmse_dy": 0.0083616366609931,
      "rmse_mean": 0.021924754604697227,
      "rotation_flip": 0.01485714316368103,
      "sparse_tokens": 16154.0,
      "step": 7662,
      "turn_loss": 0.18413934111595154,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3560211856532243,
      "grad_norm": 0.6079989075660706,
      "learning_rate": 2.9445975747156548e-06,
      "loss": 0.1229,
      "mae_dtheta": 0.0069358875043690205,
      "mae_dx": 0.0006853568484075367,
      "mae_dy": 0.0011031166650354862,
      "pose_mae_dtheta": 0.04339847341179848,
      "pose_mae_dx": 0.009225603193044662,
      "pose_mae_dy": 0.016146857291460037,
      "pose_rmse_dtheta": 0.15907485783100128,
      "pose_rmse_dx": 0.02433686889708042,
      "pose_rmse_dy": 0.04173000529408455,
      "pose_rmse_mean": 0.07504724711179733,
      "rmse_dtheta": 0.021064115688204765,
      "rmse_dx": 0.0020685147028416395,
      "rmse_dy": 0.0029577938839793205,
      "rmse_mean": 0.008696808479726315,
      "rotation_flip": 0.001500000013038516,
      "sparse_tokens": 32089.0,
      "step": 7663,
      "turn_loss": 0.049179378896951675,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3560676454190671,
      "grad_norm": 0.5969225764274597,
      "learning_rate": 2.9433923128893652e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.00884227268397808,
      "mae_dx": 0.0032468256540596485,
      "mae_dy": 0.003454202553257346,
      "pose_mae_dtheta": 0.06317088752985,
      "pose_mae_dx": 0.03618781268596649,
      "pose_mae_dy": 0.029053393751382828,
      "pose_rmse_dtheta": 0.15506939589977264,
      "pose_rmse_dx": 0.10638175159692764,
      "pose_rmse_dy": 0.07756408303976059,
      "pose_rmse_mean": 0.11300508677959442,
      "rmse_dtheta": 0.020034417510032654,
      "rmse_dx": 0.009134690277278423,
      "rmse_dy": 0.008862996473908424,
      "rmse_mean": 0.012677369639277458,
      "rotation_flip": 0.006338553503155708,
      "sparse_tokens": 32121.0,
      "step": 7664,
      "turn_loss": 0.1038249060511589,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3561141051849099,
      "grad_norm": 0.43962451815605164,
      "learning_rate": 2.942187194882754e-06,
      "loss": 0.1015,
      "mae_dtheta": 0.008660399354994297,
      "mae_dx": 0.001154802623204887,
      "mae_dy": 0.00159736187197268,
      "pose_mae_dtheta": 0.05551331490278244,
      "pose_mae_dx": 0.015827419236302376,
      "pose_mae_dy": 0.024051496759057045,
      "pose_rmse_dtheta": 0.12386026978492737,
      "pose_rmse_dx": 0.03990744426846504,
      "pose_rmse_dy": 0.060264602303504944,
      "pose_rmse_mean": 0.07467743754386902,
      "rmse_dtheta": 0.017379378899931908,
      "rmse_dx": 0.003983903210610151,
      "rmse_dy": 0.0032237975392490625,
      "rmse_mean": 0.008195693604648113,
      "rotation_flip": 0.0004123711260035634,
      "sparse_tokens": 32089.0,
      "step": 7665,
      "turn_loss": 0.06184259057044983,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.35616056495075266,
      "grad_norm": 0.3942872881889343,
      "learning_rate": 2.9409822207800976e-06,
      "loss": 0.0745,
      "mae_dtheta": 0.010893262922763824,
      "mae_dx": 0.0014212545938789845,
      "mae_dy": 0.0027231848798692226,
      "pose_mae_dtheta": 0.0634678304195404,
      "pose_mae_dx": 0.024354910477995872,
      "pose_mae_dy": 0.0314786396920681,
      "pose_rmse_dtheta": 0.12563154101371765,
      "pose_rmse_dx": 0.054551251232624054,
      "pose_rmse_dy": 0.06310392916202545,
      "pose_rmse_mean": 0.08109557628631592,
      "rmse_dtheta": 0.021230068057775497,
      "rmse_dx": 0.0032957522198557854,
      "rmse_dy": 0.0050233108922839165,
      "rmse_mean": 0.009849711321294308,
      "rotation_flip": 0.008743523620069027,
      "sparse_tokens": 32137.0,
      "step": 7666,
      "turn_loss": 0.08278655260801315,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.35620702471659543,
      "grad_norm": 0.34630751609802246,
      "learning_rate": 2.9397773906656584e-06,
      "loss": 0.1005,
      "mae_dtheta": 0.007259824313223362,
      "mae_dx": 0.0029519726522266865,
      "mae_dy": 0.0015167811652645469,
      "pose_mae_dtheta": 0.04746536165475845,
      "pose_mae_dx": 0.028363820165395737,
      "pose_mae_dy": 0.020645879209041595,
      "pose_rmse_dtheta": 0.15198378264904022,
      "pose_rmse_dx": 0.08584341406822205,
      "pose_rmse_dy": 0.058659087866544724,
      "pose_rmse_mean": 0.0988287627696991,
      "rmse_dtheta": 0.021335609257221222,
      "rmse_dx": 0.010043248534202576,
      "rmse_dy": 0.00423970352858305,
      "rmse_mean": 0.011872854083776474,
      "rotation_flip": 0.004020677879452705,
      "sparse_tokens": 32121.0,
      "step": 7667,
      "turn_loss": 0.09985429793596268,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.3562534844824382,
      "grad_norm": 0.6487584114074707,
      "learning_rate": 2.9385727046236934e-06,
      "loss": 0.1349,
      "mae_dtheta": 0.034379325807094574,
      "mae_dx": 0.016572875902056694,
      "mae_dy": 0.009132352657616138,
      "pose_mae_dtheta": 0.26720255613327026,
      "pose_mae_dx": 0.12832695245742798,
      "pose_mae_dy": 0.1393231749534607,
      "pose_rmse_dtheta": 0.427333265542984,
      "pose_rmse_dx": 0.24749945104122162,
      "pose_rmse_dy": 0.2705816328525543,
      "pose_rmse_mean": 0.3151381015777588,
      "rmse_dtheta": 0.04596935212612152,
      "rmse_dx": 0.03140111267566681,
      "rmse_dy": 0.015047160908579826,
      "rmse_mean": 0.03080587647855282,
      "rotation_flip": 0.006451612804085016,
      "sparse_tokens": 3304.0,
      "step": 7668,
      "turn_loss": 0.26339396834373474,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.356299944248281,
      "grad_norm": 0.4596378207206726,
      "learning_rate": 2.937368162738445e-06,
      "loss": 0.1488,
      "mae_dtheta": 0.007384384050965309,
      "mae_dx": 0.001433550613000989,
      "mae_dy": 0.0017835587495937943,
      "pose_mae_dtheta": 0.05057192221283913,
      "pose_mae_dx": 0.012577984482049942,
      "pose_mae_dy": 0.0212711188942194,
      "pose_rmse_dtheta": 0.14303737878799438,
      "pose_rmse_dx": 0.033051781356334686,
      "pose_rmse_dy": 0.06141519173979759,
      "pose_rmse_mean": 0.07916812598705292,
      "rmse_dtheta": 0.020137421786785126,
      "rmse_dx": 0.005610361695289612,
      "rmse_dy": 0.0066946521401405334,
      "rmse_mean": 0.01081414520740509,
      "rotation_flip": 0.0036726128309965134,
      "sparse_tokens": 32073.0,
      "step": 7669,
      "turn_loss": 0.06876876205205917,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.35634640401412376,
      "grad_norm": 0.5391879677772522,
      "learning_rate": 2.936163765094148e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.0378805436193943,
      "mae_dx": 0.009661804884672165,
      "mae_dy": 0.003486071014776826,
      "pose_mae_dtheta": 0.31059443950653076,
      "pose_mae_dx": 0.08805442601442337,
      "pose_mae_dy": 0.04876363277435303,
      "pose_rmse_dtheta": 0.5661604404449463,
      "pose_rmse_dx": 0.22418257594108582,
      "pose_rmse_dy": 0.13577361404895782,
      "pose_rmse_mean": 0.30870556831359863,
      "rmse_dtheta": 0.05954021215438843,
      "rmse_dx": 0.021465498954057693,
      "rmse_dy": 0.009053463116288185,
      "rmse_mean": 0.030019722878932953,
      "rotation_flip": 0.014723926782608032,
      "sparse_tokens": 13466.0,
      "step": 7670,
      "turn_loss": 0.2510973811149597,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.35639286377996654,
      "grad_norm": 0.728607177734375,
      "learning_rate": 2.9349595117750267e-06,
      "loss": 0.1778,
      "mae_dtheta": 0.00891850609332323,
      "mae_dx": 0.001894753659144044,
      "mae_dy": 0.002377001801505685,
      "pose_mae_dtheta": 0.059083178639411926,
      "pose_mae_dx": 0.019184237346053123,
      "pose_mae_dy": 0.02928778901696205,
      "pose_rmse_dtheta": 0.1247263178229332,
      "pose_rmse_dx": 0.04973534494638443,
      "pose_rmse_dy": 0.07300751656293869,
      "pose_rmse_mean": 0.0824897289276123,
      "rmse_dtheta": 0.018510790541768074,
      "rmse_dx": 0.005312689114362001,
      "rmse_dy": 0.005159695167094469,
      "rmse_mean": 0.009661057963967323,
      "rotation_flip": 0.0059612519107759,
      "sparse_tokens": 32121.0,
      "step": 7671,
      "turn_loss": 0.08744118362665176,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.3564393235458093,
      "grad_norm": 0.43526092171669006,
      "learning_rate": 2.9337554028652954e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.018564298748970032,
      "mae_dx": 0.0049419342540204525,
      "mae_dy": 0.0027265832759439945,
      "pose_mae_dtheta": 0.1332293301820755,
      "pose_mae_dx": 0.04302237927913666,
      "pose_mae_dy": 0.03423060476779938,
      "pose_rmse_dtheta": 0.3022174835205078,
      "pose_rmse_dx": 0.16225910186767578,
      "pose_rmse_dy": 0.11180906742811203,
      "pose_rmse_mean": 0.19209522008895874,
      "rmse_dtheta": 0.03671017289161682,
      "rmse_dx": 0.015778610482811928,
      "rmse_dy": 0.008353976532816887,
      "rmse_mean": 0.02028091996908188,
      "rotation_flip": 0.008733624592423439,
      "sparse_tokens": 12875.0,
      "step": 7672,
      "turn_loss": 0.1039988100528717,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3564857833116521,
      "grad_norm": 0.5457277894020081,
      "learning_rate": 2.9325514384491578e-06,
      "loss": 0.189,
      "mae_dtheta": 0.012038935907185078,
      "mae_dx": 0.001321780146099627,
      "mae_dy": 0.002399663208052516,
      "pose_mae_dtheta": 0.07228982448577881,
      "pose_mae_dx": 0.019360201433300972,
      "pose_mae_dy": 0.028048835694789886,
      "pose_rmse_dtheta": 0.18607208132743835,
      "pose_rmse_dx": 0.052982863038778305,
      "pose_rmse_dy": 0.0619499534368515,
      "pose_rmse_mean": 0.10033496469259262,
      "rmse_dtheta": 0.025616344064474106,
      "rmse_dx": 0.0034977311734110117,
      "rmse_dy": 0.005265394691377878,
      "rmse_mean": 0.011459823697805405,
      "rotation_flip": 0.007317073177546263,
      "sparse_tokens": 32121.0,
      "step": 7673,
      "turn_loss": 0.09325485676527023,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.35653224307749487,
      "grad_norm": 0.3605985641479492,
      "learning_rate": 2.9313476186108077e-06,
      "loss": 0.0787,
      "mae_dtheta": 0.022289950400590897,
      "mae_dx": 0.010531308129429817,
      "mae_dy": 0.002751108491793275,
      "pose_mae_dtheta": 0.1764925867319107,
      "pose_mae_dx": 0.0831301137804985,
      "pose_mae_dy": 0.035377636551856995,
      "pose_rmse_dtheta": 0.36966902017593384,
      "pose_rmse_dx": 0.22920891642570496,
      "pose_rmse_dy": 0.08119793236255646,
      "pose_rmse_mean": 0.22669194638729095,
      "rmse_dtheta": 0.03950056806206703,
      "rmse_dx": 0.024447109550237656,
      "rmse_dy": 0.005240203812718391,
      "rmse_mean": 0.023062627762556076,
      "rotation_flip": 0.008648648858070374,
      "sparse_tokens": 19753.0,
      "step": 7674,
      "turn_loss": 0.17331460118293762,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.35657870284333765,
      "grad_norm": 0.3977692127227783,
      "learning_rate": 2.9301439434344275e-06,
      "loss": 0.0795,
      "mae_dtheta": 0.00891411304473877,
      "mae_dx": 0.0015883013838902116,
      "mae_dy": 0.00023766736558172852,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3977693021297455,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 164.30853271484375,
      "model/head/act_norm_mean": 127.48838975694444,
      "model/head/act_norm_min": 71.67335510253906,
      "model/head/act_over_embed": 87.61121500608205,
      "model/head/grad_frac": 0.09401393681764603,
      "model/head/grad_norm": 0.03739585727453232,
      "model/head/grad_zero_frac": 0.00016022224735934287,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6913865214646465,
      "model/head/update_ratio": 0.000637353805359453,
      "model/head/weight_delta": 9.600314140319824,
      "model/head/weight_delta_rel": 0.16841794550418854,
      "model/head/weight_norm": 58.673622131347656,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42226335406303406,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42219565617098354,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42211276292800903,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901368075787081,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07635660469532013,
      "model/modality_embedder.encoders.pose/grad_norm": 0.030372314155101776,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5537879279045643,
      "model/modality_embedder.encoders.pose/update_ratio": 0.000980942859314382,
      "model/modality_embedder.encoders.pose/weight_delta": 3.074978828430176,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10046914219856262,
      "model/modality_embedder.encoders.pose/weight_norm": 30.962369918823242,
      "model/modality_embedder/grad_frac": 0.07635660469532013,
      "model/modality_embedder/grad_norm": 0.030372314155101776,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5537879279045643,
      "model/modality_embedder/update_ratio": 0.000980942859314382,
      "model/modality_embedder/weight_delta": 3.074978828430176,
      "model/modality_embedder/weight_delta_rel": 0.10046914219856262,
      "model/modality_embedder/weight_norm": 30.962369918823242,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 93.77465057373047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.386932319223988,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.884503364562988,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.446137565975746,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06516376882791519,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.025920147076249123,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009283972322009504,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5541958808898926,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0930764377117157,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.91924285888672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 95.62703704833984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.4486206309123,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.007169723510742,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.17573971345053,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06617330759763718,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.026321709156036377,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008861375972628593,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.240600347518921,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11225692927837372,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.7038631439209,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 97.39945983886719,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.30332842312009,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 11.740579605102539,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.45031227230365,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06491313129663467,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.025820450857281685,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008418674115091562,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5007221698760986,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11754769831895828,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.670448303222656,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 97.86064147949219,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.95434754288921,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.89815902709961,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.58490806849352,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07151034474372864,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.028444619849324226,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009513355325907469,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 2.997680187225342,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10244648158550262,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.89967155456543,
      "model/normalizer/grad_frac": 0.266348659992218,
      "model/normalizer/grad_norm": 0.10594531893730164,
      "model/normalizer/grad_zero_frac": 0.00015835295198485255,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0013482078211382031,
      "model/normalizer/weight_delta": 6.329837799072266,
      "model/normalizer/weight_delta_rel": 0.08152464777231216,
      "model/normalizer/weight_norm": 78.58233642578125,
      "pose_mae_dtheta": 0.06323801726102829,
      "pose_mae_dx": 0.011832254007458687,
      "pose_mae_dy": 0.0031060571782290936,
      "pose_rmse_dtheta": 0.2642480134963989,
      "pose_rmse_dx": 0.030809370800852776,
      "pose_rmse_dy": 0.0070821684785187244,
      "pose_rmse_mean": 0.10071318596601486,
      "rmse_dtheta": 0.032054353505373,
      "rmse_dx": 0.004602103028446436,
      "rmse_dy": 0.0005486995214596391,
      "rmse_mean": 0.012401718646287918,
      "rotation_flip": 0.002144772093743086,
      "sparse_tokens": 32249.0,
      "step": 7675,
      "turn_loss": 0.05206124484539032,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3566251626091804,
      "grad_norm": 0.36947575211524963,
      "learning_rate": 2.928940413004195e-06,
      "loss": 0.0609,
      "mae_dtheta": 0.007940542884171009,
      "mae_dx": 0.0015145561192184687,
      "mae_dy": 0.0017686609644442797,
      "pose_mae_dtheta": 0.055364806205034256,
      "pose_mae_dx": 0.019866451621055603,
      "pose_mae_dy": 0.01939551532268524,
      "pose_rmse_dtheta": 0.14825384318828583,
      "pose_rmse_dx": 0.060126177966594696,
      "pose_rmse_dy": 0.0459592305123806,
      "pose_rmse_mean": 0.084779754281044,
      "rmse_dtheta": 0.020446280017495155,
      "rmse_dx": 0.005134617909789085,
      "rmse_dy": 0.004140513949096203,
      "rmse_mean": 0.009907137602567673,
      "rotation_flip": 0.0013586956774815917,
      "sparse_tokens": 32089.0,
      "step": 7676,
      "turn_loss": 0.06614957004785538,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.35667162237502326,
      "grad_norm": 0.5220353007316589,
      "learning_rate": 2.927737027404268e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.014739272184669971,
      "mae_dx": 0.0036536534316837788,
      "mae_dy": 0.0036659734323620796,
      "pose_mae_dtheta": 0.10310231894254684,
      "pose_mae_dx": 0.037033725529909134,
      "pose_mae_dy": 0.03444886580109596,
      "pose_rmse_dtheta": 0.25743600726127625,
      "pose_rmse_dx": 0.09017995744943619,
      "pose_rmse_dy": 0.07430720329284668,
      "pose_rmse_mean": 0.14064106345176697,
      "rmse_dtheta": 0.03139109164476395,
      "rmse_dx": 0.011025886982679367,
      "rmse_dy": 0.00844621006399393,
      "rmse_mean": 0.016954395920038223,
      "rotation_flip": 0.006284657865762711,
      "sparse_tokens": 32105.0,
      "step": 7677,
      "turn_loss": 0.14295469224452972,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.35671808214086603,
      "grad_norm": 0.3803272247314453,
      "learning_rate": 2.926533786718806e-06,
      "loss": 0.0915,
      "mae_dtheta": 0.01009447779506445,
      "mae_dx": 0.0011939335381612182,
      "mae_dy": 0.0017590158386155963,
      "pose_mae_dtheta": 0.06534496694803238,
      "pose_mae_dx": 0.018325412645936012,
      "pose_mae_dy": 0.025338465347886086,
      "pose_rmse_dtheta": 0.1746210753917694,
      "pose_rmse_dx": 0.05062069743871689,
      "pose_rmse_dy": 0.0564848966896534,
      "pose_rmse_mean": 0.0939088985323906,
      "rmse_dtheta": 0.021513354033231735,
      "rmse_dx": 0.0040775686502456665,
      "rmse_dy": 0.0036295647732913494,
      "rmse_mean": 0.009740162640810013,
      "rotation_flip": 0.0025083611253648996,
      "sparse_tokens": 32041.0,
      "step": 7678,
      "turn_loss": 0.07120966166257858,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.3567645419067088,
      "grad_norm": 0.46863704919815063,
      "learning_rate": 2.925330691031947e-06,
      "loss": 0.0876,
      "mae_dtheta": 0.03566257655620575,
      "mae_dx": 0.011016587726771832,
      "mae_dy": 0.005622695200145245,
      "pose_mae_dtheta": 0.28144896030426025,
      "pose_mae_dx": 0.08573275059461594,
      "pose_mae_dy": 0.07307089120149612,
      "pose_rmse_dtheta": 0.45305418968200684,
      "pose_rmse_dx": 0.19077906012535095,
      "pose_rmse_dy": 0.1859464794397354,
      "pose_rmse_mean": 0.27659326791763306,
      "rmse_dtheta": 0.050044335424900055,
      "rmse_dx": 0.022622916847467422,
      "rmse_dy": 0.012032625265419483,
      "rmse_mean": 0.028233295306563377,
      "rotation_flip": 0.017316017299890518,
      "sparse_tokens": 12691.0,
      "step": 7679,
      "turn_loss": 0.3205604553222656,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3568110016725516,
      "grad_norm": 0.49231594800949097,
      "learning_rate": 2.924127740427826e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.006297295447438955,
      "mae_dx": 0.0023152183275669813,
      "mae_dy": 0.00048559141578152776,
      "pose_mae_dtheta": 0.04532353952527046,
      "pose_mae_dx": 0.018996061757206917,
      "pose_mae_dy": 0.005406390409916639,
      "pose_rmse_dtheta": 0.19961383938789368,
      "pose_rmse_dx": 0.0676569938659668,
      "pose_rmse_dy": 0.012963294051587582,
      "pose_rmse_mean": 0.09341137856245041,
      "rmse_dtheta": 0.024714812636375427,
      "rmse_dx": 0.007428766693919897,
      "rmse_dy": 0.0015301513485610485,
      "rmse_mean": 0.011224577203392982,
      "rotation_flip": 0.0012658227933570743,
      "sparse_tokens": 32201.0,
      "step": 7680,
      "turn_loss": 0.07035943865776062,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32339.0,
      "epoch": 0.35685746143839436,
      "grad_norm": 0.6729226112365723,
      "learning_rate": 2.9229249349905686e-06,
      "loss": 0.19,
      "mae_dtheta": 0.037101130932569504,
      "mae_dx": 0.012321378104388714,
      "mae_dy": 0.005753502249717712,
      "pose_mae_dtheta": 0.29937055706977844,
      "pose_mae_dx": 0.10023744404315948,
      "pose_mae_dy": 0.06314421445131302,
      "pose_rmse_dtheta": 0.5070164799690247,
      "pose_rmse_dx": 0.211762934923172,
      "pose_rmse_dy": 0.15445950627326965,
      "pose_rmse_mean": 0.29107964038848877,
      "rmse_dtheta": 0.05504441261291504,
      "rmse_dx": 0.023751292377710342,
      "rmse_dy": 0.012617703527212143,
      "rmse_mean": 0.030471136793494225,
      "rotation_flip": 0.02044728398323059,
      "sparse_tokens": 23537.0,
      "step": 7681,
      "turn_loss": 0.32318297028541565,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.35690392120423714,
      "grad_norm": 0.5909092426300049,
      "learning_rate": 2.921722274804283e-06,
      "loss": 0.0787,
      "mae_dtheta": 0.010204085148870945,
      "mae_dx": 0.0011306351516395807,
      "mae_dy": 0.0024751415476202965,
      "pose_mae_dtheta": 0.0682273879647255,
      "pose_mae_dx": 0.0207519493997097,
      "pose_mae_dy": 0.028418609872460365,
      "pose_rmse_dtheta": 0.18154774606227875,
      "pose_rmse_dx": 0.05760840326547623,
      "pose_rmse_dy": 0.066486656665802,
      "pose_rmse_mean": 0.10188093781471252,
      "rmse_dtheta": 0.022118397057056427,
      "rmse_dx": 0.0030940440483391285,
      "rmse_dy": 0.005198527127504349,
      "rmse_mean": 0.010136989876627922,
      "rotation_flip": 0.002694380236789584,
      "sparse_tokens": 32057.0,
      "step": 7682,
      "turn_loss": 0.0743282213807106,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 38494.0,
      "epoch": 0.3569503809700799,
      "grad_norm": 0.6678235530853271,
      "learning_rate": 2.9205197599530764e-06,
      "loss": 0.1706,
      "mae_dtheta": 0.03174775466322899,
      "mae_dx": 0.013583716936409473,
      "mae_dy": 0.005057981237769127,
      "pose_mae_dtheta": 0.25772514939308167,
      "pose_mae_dx": 0.11012424528598785,
      "pose_mae_dy": 0.05280119180679321,
      "pose_rmse_dtheta": 0.43703535199165344,
      "pose_rmse_dx": 0.24300150573253632,
      "pose_rmse_dy": 0.12670308351516724,
      "pose_rmse_mean": 0.2689133286476135,
      "rmse_dtheta": 0.047989048063755035,
      "rmse_dx": 0.026222320273518562,
      "rmse_dy": 0.010486239567399025,
      "rmse_mean": 0.02823253534734249,
      "rotation_flip": 0.010857142508029938,
      "sparse_tokens": 28417.0,
      "step": 7683,
      "turn_loss": 0.26752591133117676,
      "turns": 119.0,
      "turns_per_sample": 119.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.3569968407359227,
      "grad_norm": 0.3994148075580597,
      "learning_rate": 2.919317390521037e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.040343448519706726,
      "mae_dx": 0.01078772358596325,
      "mae_dy": 0.0048249950632452965,
      "pose_mae_dtheta": 0.34268414974212646,
      "pose_mae_dx": 0.08627262711524963,
      "pose_mae_dy": 0.03951220214366913,
      "pose_rmse_dtheta": 0.6022199392318726,
      "pose_rmse_dx": 0.19103889167308807,
      "pose_rmse_dy": 0.0810774639248848,
      "pose_rmse_mean": 0.29144543409347534,
      "rmse_dtheta": 0.062003619968891144,
      "rmse_dx": 0.02289559878408909,
      "rmse_dy": 0.009656332433223724,
      "rmse_mean": 0.031518518924713135,
      "rotation_flip": 0.013173652812838554,
      "sparse_tokens": 13858.0,
      "step": 7684,
      "turn_loss": 0.3579481244087219,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.35704330050176547,
      "grad_norm": 0.6657335162162781,
      "learning_rate": 2.9181151665922524e-06,
      "loss": 0.0893,
      "mae_dtheta": 0.0315672941505909,
      "mae_dx": 0.012815220281481743,
      "mae_dy": 0.004767014645040035,
      "pose_mae_dtheta": 0.30786430835723877,
      "pose_mae_dx": 0.1164301186800003,
      "pose_mae_dy": 0.08064409345388412,
      "pose_rmse_dtheta": 0.5003798007965088,
      "pose_rmse_dx": 0.24348284304141998,
      "pose_rmse_dy": 0.15097330510616302,
      "pose_rmse_mean": 0.29827865958213806,
      "rmse_dtheta": 0.048248305916786194,
      "rmse_dx": 0.026543624699115753,
      "rmse_dy": 0.008156098425388336,
      "rmse_mean": 0.027649343013763428,
      "rotation_flip": 0.011029412038624287,
      "sparse_tokens": 4751.0,
      "step": 7685,
      "turn_loss": 0.20996710658073425,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.35708976026760825,
      "grad_norm": 0.6807795166969299,
      "learning_rate": 2.916913088250789e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.032042935490608215,
      "mae_dx": 0.01639568619430065,
      "mae_dy": 0.010267863981425762,
      "pose_mae_dtheta": 0.2334088832139969,
      "pose_mae_dx": 0.10982207208871841,
      "pose_mae_dy": 0.08777965605258942,
      "pose_rmse_dtheta": 0.4189968705177307,
      "pose_rmse_dx": 0.22420278191566467,
      "pose_rmse_dy": 0.15920189023017883,
      "pose_rmse_mean": 0.267467200756073,
      "rmse_dtheta": 0.048724330961704254,
      "rmse_dx": 0.02930735982954502,
      "rmse_dy": 0.017765115946531296,
      "rmse_mean": 0.031932272017002106,
      "rotation_flip": 0.009541984647512436,
      "sparse_tokens": 9471.0,
      "step": 7686,
      "turn_loss": 0.2898760437965393,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.357136220033451,
      "grad_norm": 1.1818866729736328,
      "learning_rate": 2.9157111555807103e-06,
      "loss": 0.2191,
      "mae_dtheta": 0.022444237023591995,
      "mae_dx": 0.0048909662291407585,
      "mae_dy": 0.0030421612318605185,
      "pose_mae_dtheta": 0.1950833797454834,
      "pose_mae_dx": 0.040755730122327805,
      "pose_mae_dy": 0.027794916182756424,
      "pose_rmse_dtheta": 0.3303353488445282,
      "pose_rmse_dx": 0.08332554996013641,
      "pose_rmse_dy": 0.0684332549571991,
      "pose_rmse_mean": 0.1606980562210083,
      "rmse_dtheta": 0.03815368935465813,
      "rmse_dx": 0.010781064629554749,
      "rmse_dy": 0.006692936178296804,
      "rmse_mean": 0.018542563542723656,
      "rotation_flip": 0.010362694039940834,
      "sparse_tokens": 3211.0,
      "step": 7687,
      "turn_loss": 0.1771944761276245,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.3571826797992938,
      "grad_norm": 0.4425472915172577,
      "learning_rate": 2.914509368666072e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.019036538898944855,
      "mae_dx": 0.002907885704189539,
      "mae_dy": 0.004660331178456545,
      "pose_mae_dtheta": 0.12252242863178253,
      "pose_mae_dx": 0.03095058724284172,
      "pose_mae_dy": 0.06312987953424454,
      "pose_rmse_dtheta": 0.24637757241725922,
      "pose_rmse_dx": 0.07257688790559769,
      "pose_rmse_dy": 0.15845708549022675,
      "pose_rmse_mean": 0.15913718938827515,
      "rmse_dtheta": 0.03299415111541748,
      "rmse_dx": 0.008426920510828495,
      "rmse_dy": 0.010002151131629944,
      "rmse_mean": 0.017141073942184448,
      "rotation_flip": 0.012237762100994587,
      "sparse_tokens": 13055.0,
      "step": 7688,
      "turn_loss": 0.14928637444972992,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3572291395651366,
      "grad_norm": 0.5822498798370361,
      "learning_rate": 2.9133077275909112e-06,
      "loss": 0.0979,
      "mae_dtheta": 0.008916073478758335,
      "mae_dx": 0.0009038358693942428,
      "mae_dy": 0.0017355080926790833,
      "pose_mae_dtheta": 0.056695420295000076,
      "pose_mae_dx": 0.013534849509596825,
      "pose_mae_dy": 0.023880159482359886,
      "pose_rmse_dtheta": 0.16890071332454681,
      "pose_rmse_dx": 0.03144722804427147,
      "pose_rmse_dy": 0.06800772994756699,
      "pose_rmse_mean": 0.08945189416408539,
      "rmse_dtheta": 0.021769706159830093,
      "rmse_dx": 0.002340331207960844,
      "rmse_dy": 0.003963921219110489,
      "rmse_mean": 0.009357986971735954,
      "rotation_flip": 0.008158507756888866,
      "sparse_tokens": 32121.0,
      "step": 7689,
      "turn_loss": 0.07786747813224792,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.35727559933097935,
      "grad_norm": 0.46349215507507324,
      "learning_rate": 2.9121062324392626e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.03588517755270004,
      "mae_dx": 0.008284015581011772,
      "mae_dy": 0.004049377515912056,
      "pose_mae_dtheta": 0.2995070815086365,
      "pose_mae_dx": 0.060070063918828964,
      "pose_mae_dy": 0.04278670251369476,
      "pose_rmse_dtheta": 0.5049862861633301,
      "pose_rmse_dx": 0.14556454122066498,
      "pose_rmse_dy": 0.10520155727863312,
      "pose_rmse_mean": 0.2519174814224243,
      "rmse_dtheta": 0.05283229425549507,
      "rmse_dx": 0.0184593815356493,
      "rmse_dy": 0.009555937722325325,
      "rmse_mean": 0.0269492045044899,
      "rotation_flip": 0.015122873708605766,
      "sparse_tokens": 9011.0,
      "step": 7690,
      "turn_loss": 0.20375746488571167,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.35732205909682213,
      "grad_norm": 0.5875146985054016,
      "learning_rate": 2.9109048832951435e-06,
      "loss": 0.1235,
      "mae_dtheta": 0.029753198847174644,
      "mae_dx": 0.00996667891740799,
      "mae_dy": 0.0020916499197483063,
      "pose_mae_dtheta": 0.20413318276405334,
      "pose_mae_dx": 0.07536027580499649,
      "pose_mae_dy": 0.021428192034363747,
      "pose_rmse_dtheta": 0.4102017879486084,
      "pose_rmse_dx": 0.20875973999500275,
      "pose_rmse_dy": 0.048276495188474655,
      "pose_rmse_mean": 0.22241267561912537,
      "rmse_dtheta": 0.048943132162094116,
      "rmse_dx": 0.02287599816918373,
      "rmse_dy": 0.00392183568328619,
      "rmse_mean": 0.025246988981962204,
      "rotation_flip": 0.0020964359864592552,
      "sparse_tokens": 8096.0,
      "step": 7691,
      "turn_loss": 0.19826757907867432,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.3573685188626649,
      "grad_norm": 0.8381443023681641,
      "learning_rate": 2.909703680242569e-06,
      "loss": 0.1966,
      "mae_dtheta": 0.036816880106925964,
      "mae_dx": 0.010858570225536823,
      "mae_dy": 0.012211722321808338,
      "pose_mae_dtheta": 0.31386062502861023,
      "pose_mae_dx": 0.10864564031362534,
      "pose_mae_dy": 0.17784471809864044,
      "pose_rmse_dtheta": 0.5034072399139404,
      "pose_rmse_dx": 0.2408587485551834,
      "pose_rmse_dy": 0.3255688548088074,
      "pose_rmse_mean": 0.35661160945892334,
      "rmse_dtheta": 0.05329793319106102,
      "rmse_dx": 0.023892484605312347,
      "rmse_dy": 0.021276379004120827,
      "rmse_mean": 0.03282226622104645,
      "rotation_flip": 0.013937282375991344,
      "sparse_tokens": 5819.0,
      "step": 7692,
      "turn_loss": 0.35907605290412903,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 33960.0,
      "epoch": 0.3574149786285077,
      "grad_norm": 0.6324707865715027,
      "learning_rate": 2.9085026233655367e-06,
      "loss": 0.0993,
      "mae_dtheta": 0.030405066907405853,
      "mae_dx": 0.015365825966000557,
      "mae_dy": 0.003397901076823473,
      "pose_mae_dtheta": 0.23874063789844513,
      "pose_mae_dx": 0.1323227882385254,
      "pose_mae_dy": 0.050457555800676346,
      "pose_rmse_dtheta": 0.4415053427219391,
      "pose_rmse_dx": 0.3022505044937134,
      "pose_rmse_dy": 0.13528011739253998,
      "pose_rmse_mean": 0.29301199316978455,
      "rmse_dtheta": 0.04835649952292442,
      "rmse_dx": 0.030189987272024155,
      "rmse_dy": 0.006378034129738808,
      "rmse_mean": 0.028308173641562462,
      "rotation_flip": 0.015540015883743763,
      "sparse_tokens": 27468.0,
      "step": 7693,
      "turn_loss": 0.24500271677970886,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3574614383943505,
      "grad_norm": 0.6416366100311279,
      "learning_rate": 2.9073017127480385e-06,
      "loss": 0.117,
      "mae_dtheta": 0.008851774968206882,
      "mae_dx": 0.0013481267960742116,
      "mae_dy": 0.0018426429014652967,
      "pose_mae_dtheta": 0.05462183430790901,
      "pose_mae_dx": 0.013344925828278065,
      "pose_mae_dy": 0.021201319992542267,
      "pose_rmse_dtheta": 0.14107507467269897,
      "pose_rmse_dx": 0.02927846647799015,
      "pose_rmse_dy": 0.04868793115019798,
      "pose_rmse_mean": 0.07301382720470428,
      "rmse_dtheta": 0.01973562315106392,
      "rmse_dx": 0.004697257187217474,
      "rmse_dy": 0.004185664467513561,
      "rmse_mean": 0.009539514780044556,
      "rotation_flip": 0.010033444501459599,
      "sparse_tokens": 32137.0,
      "step": 7694,
      "turn_loss": 0.07307393848896027,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29431.0,
      "epoch": 0.3575078981601933,
      "grad_norm": 0.5973965525627136,
      "learning_rate": 2.9061009484740564e-06,
      "loss": 0.121,
      "mae_dtheta": 0.04486433416604996,
      "mae_dx": 0.016772426664829254,
      "mae_dy": 0.004643884487450123,
      "pose_mae_dtheta": 0.39667922258377075,
      "pose_mae_dx": 0.13790839910507202,
      "pose_mae_dy": 0.05468355864286423,
      "pose_rmse_dtheta": 0.6268482804298401,
      "pose_rmse_dx": 0.2776348292827606,
      "pose_rmse_dy": 0.1269250065088272,
      "pose_rmse_mean": 0.34380269050598145,
      "rmse_dtheta": 0.0623982772231102,
      "rmse_dx": 0.029872531071305275,
      "rmse_dy": 0.009629241190850735,
      "rmse_mean": 0.033966682851314545,
      "rotation_flip": 0.018207283690571785,
      "sparse_tokens": 22886.0,
      "step": 7695,
      "turn_loss": 0.341230183839798,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35755435792603607,
      "grad_norm": 0.3726188540458679,
      "learning_rate": 2.9049003306275575e-06,
      "loss": 0.0813,
      "mae_dtheta": 0.009323295205831528,
      "mae_dx": 0.0022818760480731726,
      "mae_dy": 0.0029458848293870687,
      "pose_mae_dtheta": 0.06270845979452133,
      "pose_mae_dx": 0.022792024537920952,
      "pose_mae_dy": 0.02771732024848461,
      "pose_rmse_dtheta": 0.15615250170230865,
      "pose_rmse_dx": 0.07231409847736359,
      "pose_rmse_dy": 0.09104989469051361,
      "pose_rmse_mean": 0.10650549829006195,
      "rmse_dtheta": 0.0221390537917614,
      "rmse_dx": 0.007839756086468697,
      "rmse_dy": 0.008298815228044987,
      "rmse_mean": 0.012759208679199219,
      "rotation_flip": 0.00669216038659215,
      "sparse_tokens": 32089.0,
      "step": 7696,
      "turn_loss": 0.09921732544898987,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.35760081769187885,
      "grad_norm": 0.6521410942077637,
      "learning_rate": 2.903699859292505e-06,
      "loss": 0.1446,
      "mae_dtheta": 0.035349272191524506,
      "mae_dx": 0.008665043860673904,
      "mae_dy": 0.004156933631747961,
      "pose_mae_dtheta": 0.250664085149765,
      "pose_mae_dx": 0.0684281438589096,
      "pose_mae_dy": 0.05377594009041786,
      "pose_rmse_dtheta": 0.472301185131073,
      "pose_rmse_dx": 0.17199115455150604,
      "pose_rmse_dy": 0.1363784670829773,
      "pose_rmse_mean": 0.2602236270904541,
      "rmse_dtheta": 0.0547817088663578,
      "rmse_dx": 0.01957153156399727,
      "rmse_dy": 0.009064022451639175,
      "rmse_mean": 0.027805756777524948,
      "rotation_flip": 0.01480836234986782,
      "sparse_tokens": 19425.0,
      "step": 7697,
      "turn_loss": 0.22142285108566284,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.3576472774577216,
      "grad_norm": 0.6730322241783142,
      "learning_rate": 2.902499534552844e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.03780359402298927,
      "mae_dx": 0.00928500946611166,
      "mae_dy": 0.004169283900409937,
      "pose_mae_dtheta": 0.3116553723812103,
      "pose_mae_dx": 0.06487003713846207,
      "pose_mae_dy": 0.042541734874248505,
      "pose_rmse_dtheta": 0.5688244700431824,
      "pose_rmse_dx": 0.16237561404705048,
      "pose_rmse_dy": 0.11304768174886703,
      "pose_rmse_mean": 0.2814159393310547,
      "rmse_dtheta": 0.05891026556491852,
      "rmse_dx": 0.021513134241104126,
      "rmse_dy": 0.008947476744651794,
      "rmse_mean": 0.02979029342532158,
      "rotation_flip": 0.027859237045049667,
      "sparse_tokens": 12304.0,
      "step": 7698,
      "turn_loss": 0.22733205556869507,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3576937372235644,
      "grad_norm": 0.5393156409263611,
      "learning_rate": 2.901299356492516e-06,
      "loss": 0.0736,
      "mae_dtheta": 0.01174799632281065,
      "mae_dx": 0.002078148303553462,
      "mae_dy": 0.0030639481265097857,
      "pose_mae_dtheta": 0.08472378551959991,
      "pose_mae_dx": 0.02326054684817791,
      "pose_mae_dy": 0.032936252653598785,
      "pose_rmse_dtheta": 0.20431146025657654,
      "pose_rmse_dx": 0.06717351078987122,
      "pose_rmse_dy": 0.09390285611152649,
      "pose_rmse_mean": 0.12179594486951828,
      "rmse_dtheta": 0.025724822655320168,
      "rmse_dx": 0.0066307964734733105,
      "rmse_dy": 0.007872096262872219,
      "rmse_mean": 0.013409238308668137,
      "rotation_flip": 0.004545454401522875,
      "sparse_tokens": 32089.0,
      "step": 7699,
      "turn_loss": 0.09017018228769302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3577401969894072,
      "grad_norm": 0.6005300879478455,
      "learning_rate": 2.900099325195453e-06,
      "loss": 0.089,
      "mae_dtheta": 0.007415851578116417,
      "mae_dx": 0.0011729259276762605,
      "mae_dy": 0.0013881113845854998,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6005299091339111,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.39166259765625,
      "model/head/act_norm_mean": 119.73388178661617,
      "model/head/act_norm_min": 75.9022445678711,
      "model/head/act_over_embed": 82.28224453002503,
      "model/head/grad_frac": 0.07741966098546982,
      "model/head/grad_norm": 0.04649282246828079,
      "model/head/grad_zero_frac": 0.0001932185114128515,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7034998421717171,
      "model/head/update_ratio": 0.0007923796074464917,
      "model/head/weight_delta": 9.606924057006836,
      "model/head/weight_delta_rel": 0.16853390634059906,
      "model/head/weight_norm": 58.67493438720703,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4222809970378876,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42221400291408034,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4221358299255371,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29014941563232916,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07122616469860077,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04277344420552254,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5209403538812786,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013814528938382864,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0754506587982178,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10048455744981766,
      "model/modality_embedder.encoders.pose/weight_norm": 30.9626522064209,
      "model/modality_embedder/grad_frac": 0.07122616469860077,
      "model/modality_embedder/grad_norm": 0.04277344420552254,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5209403538812786,
      "model/modality_embedder/update_ratio": 0.0013814528938382864,
      "model/modality_embedder/weight_delta": 3.0754506587982178,
      "model/modality_embedder/weight_delta_rel": 0.10048455744981766,
      "model/modality_embedder/weight_norm": 30.9626522064209,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.0483169555664,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.532292167708835,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.039441108703613,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.858820852587375,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06843584030866623,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.041097767651081085,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014719830360263586,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5574378967285156,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09319458156824112,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.920000076293945,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.88391876220703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.527489678531346,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.30980396270752,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.542729899210492,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06885634362697601,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04135029390454292,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013920370256528258,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2443864345550537,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11238808184862137,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.70488166809082,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.51610565185547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.397662137245472,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.05034351348877,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.827929921669256,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0769968181848526,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.046238891780376434,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 9.0784378699027e-05,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015075424453243613,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.505110502243042,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11769504845142365,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.671701431274414,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.26850891113281,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.0743421316338,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.182966232299805,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.980160111138336,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08924715220928192,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05359558388590813,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017924653366208076,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.00171160697937,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10258425772190094,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.90048599243164,
      "model/normalizer/grad_frac": 0.36677879095077515,
      "model/normalizer/grad_norm": 0.22026163339614868,
      "model/normalizer/grad_zero_frac": 0.00012526426871772856,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00280290050432086,
      "model/normalizer/weight_delta": 6.337783336639404,
      "model/normalizer/weight_delta_rel": 0.08162698149681091,
      "model/normalizer/weight_norm": 78.58346557617188,
      "pose_mae_dtheta": 0.047582194209098816,
      "pose_mae_dx": 0.014112279750406742,
      "pose_mae_dy": 0.01811385154724121,
      "pose_rmse_dtheta": 0.12223896384239197,
      "pose_rmse_dx": 0.03683110326528549,
      "pose_rmse_dy": 0.040944721549749374,
      "pose_rmse_mean": 0.06667160242795944,
      "rmse_dtheta": 0.01686030812561512,
      "rmse_dx": 0.004169205203652382,
      "rmse_dy": 0.0028782100416719913,
      "rmse_mean": 0.007969241589307785,
      "rotation_flip": 0.003629764076322317,
      "sparse_tokens": 32073.0,
      "step": 7700,
      "turn_loss": 0.062233198434114456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.35778665675524995,
      "grad_norm": 0.5443909764289856,
      "learning_rate": 2.898899440745569e-06,
      "loss": 0.0806,
      "mae_dtheta": 0.02912816032767296,
      "mae_dx": 0.009160038083791733,
      "mae_dy": 0.006001843139529228,
      "pose_mae_dtheta": 0.26065006852149963,
      "pose_mae_dx": 0.07702317833900452,
      "pose_mae_dy": 0.08884523063898087,
      "pose_rmse_dtheta": 0.48780500888824463,
      "pose_rmse_dx": 0.16408111155033112,
      "pose_rmse_dy": 0.18539847433567047,
      "pose_rmse_mean": 0.2790948748588562,
      "rmse_dtheta": 0.04660689830780029,
      "rmse_dx": 0.02092115394771099,
      "rmse_dy": 0.010068819858133793,
      "rmse_mean": 0.025865625590085983,
      "rotation_flip": 0.010619468986988068,
      "sparse_tokens": 10141.0,
      "step": 7701,
      "turn_loss": 0.2561687231063843,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 11021.0,
      "epoch": 0.35783311652109273,
      "grad_norm": 0.6408792734146118,
      "learning_rate": 2.8976997032267775e-06,
      "loss": 0.1621,
      "mae_dtheta": 0.03192378953099251,
      "mae_dx": 0.015885192900896072,
      "mae_dy": 0.006371476221829653,
      "pose_mae_dtheta": 0.2286514788866043,
      "pose_mae_dx": 0.15105178952217102,
      "pose_mae_dy": 0.11153479665517807,
      "pose_rmse_dtheta": 0.3788415789604187,
      "pose_rmse_dx": 0.3200971186161041,
      "pose_rmse_dy": 0.2275974601507187,
      "pose_rmse_mean": 0.3088454008102417,
      "rmse_dtheta": 0.04596627503633499,
      "rmse_dx": 0.031436946243047714,
      "rmse_dy": 0.01088277529925108,
      "rmse_mean": 0.029428664594888687,
      "rotation_flip": 0.01217038556933403,
      "sparse_tokens": 8796.0,
      "step": 7702,
      "turn_loss": 0.2384643852710724,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3578795762869355,
      "grad_norm": 0.47754690051078796,
      "learning_rate": 2.8965001127229707e-06,
      "loss": 0.1052,
      "mae_dtheta": 0.007605165243148804,
      "mae_dx": 0.002383744576945901,
      "mae_dy": 0.0019580316729843616,
      "pose_mae_dtheta": 0.0546121709048748,
      "pose_mae_dx": 0.02466130629181862,
      "pose_mae_dy": 0.019526762887835503,
      "pose_rmse_dtheta": 0.1704624593257904,
      "pose_rmse_dx": 0.08787602186203003,
      "pose_rmse_dy": 0.0622166246175766,
      "pose_rmse_mean": 0.10685169696807861,
      "rmse_dtheta": 0.020907802507281303,
      "rmse_dx": 0.008737110532820225,
      "rmse_dy": 0.0059293704107403755,
      "rmse_mean": 0.011858094483613968,
      "rotation_flip": 0.004100761376321316,
      "sparse_tokens": 32073.0,
      "step": 7703,
      "turn_loss": 0.07284260541200638,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.3579260360527783,
      "grad_norm": 1.0406322479248047,
      "learning_rate": 2.895300669318043e-06,
      "loss": 0.3245,
      "mae_dtheta": 0.02991255559027195,
      "mae_dx": 0.015436001121997833,
      "mae_dy": 0.00803048349916935,
      "pose_mae_dtheta": 0.21263228356838226,
      "pose_mae_dx": 0.11852451413869858,
      "pose_mae_dy": 0.09572885930538177,
      "pose_rmse_dtheta": 0.30399566888809204,
      "pose_rmse_dx": 0.21401546895503998,
      "pose_rmse_dy": 0.18754138052463531,
      "pose_rmse_mean": 0.2351841777563095,
      "rmse_dtheta": 0.04177449271082878,
      "rmse_dx": 0.027552949264645576,
      "rmse_dy": 0.012115465477108955,
      "rmse_mean": 0.02714763581752777,
      "rotation_flip": 0.014652014710009098,
      "sparse_tokens": 8596.0,
      "step": 7704,
      "turn_loss": 0.35657286643981934,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.35797249581862106,
      "grad_norm": 0.7023431658744812,
      "learning_rate": 2.8941013730958674e-06,
      "loss": 0.0764,
      "mae_dtheta": 0.009039124473929405,
      "mae_dx": 0.0011381169315427542,
      "mae_dy": 0.0014541459968313575,
      "pose_mae_dtheta": 0.06619729846715927,
      "pose_mae_dx": 0.014787127263844013,
      "pose_mae_dy": 0.02069099061191082,
      "pose_rmse_dtheta": 0.2282545268535614,
      "pose_rmse_dx": 0.04243811219930649,
      "pose_rmse_dy": 0.05834219604730606,
      "pose_rmse_mean": 0.10967828333377838,
      "rmse_dtheta": 0.025503112003207207,
      "rmse_dx": 0.0036701809149235487,
      "rmse_dy": 0.0035027475096285343,
      "rmse_mean": 0.010892014019191265,
      "rotation_flip": 0.004261363763362169,
      "sparse_tokens": 32105.0,
      "step": 7705,
      "turn_loss": 0.06410349905490875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.35801895558446384,
      "grad_norm": 0.5236155986785889,
      "learning_rate": 2.8929022241403126e-06,
      "loss": 0.0882,
      "mae_dtheta": 0.0049994755536317825,
      "mae_dx": 0.0008947000023908913,
      "mae_dy": 0.001025213161483407,
      "pose_mae_dtheta": 0.03542657196521759,
      "pose_mae_dx": 0.009814738295972347,
      "pose_mae_dy": 0.014734463766217232,
      "pose_rmse_dtheta": 0.12172837555408478,
      "pose_rmse_dx": 0.027725649997591972,
      "pose_rmse_dy": 0.040384259074926376,
      "pose_rmse_mean": 0.06327943503856659,
      "rmse_dtheta": 0.016178399324417114,
      "rmse_dx": 0.0034892847761511803,
      "rmse_dy": 0.0024973261170089245,
      "rmse_mean": 0.007388337515294552,
      "rotation_flip": 0.002562460023909807,
      "sparse_tokens": 32057.0,
      "step": 7706,
      "turn_loss": 0.03960781544446945,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3580654153503066,
      "grad_norm": 0.6979645490646362,
      "learning_rate": 2.8917032225352382e-06,
      "loss": 0.1136,
      "mae_dtheta": 0.007386782206594944,
      "mae_dx": 0.001890370505861938,
      "mae_dy": 0.002066883258521557,
      "pose_mae_dtheta": 0.050965581089258194,
      "pose_mae_dx": 0.0251628290861845,
      "pose_mae_dy": 0.021898340433835983,
      "pose_rmse_dtheta": 0.14663344621658325,
      "pose_rmse_dx": 0.0841975063085556,
      "pose_rmse_dy": 0.07123322039842606,
      "pose_rmse_mean": 0.10068806260824203,
      "rmse_dtheta": 0.01762349158525467,
      "rmse_dx": 0.005861973389983177,
      "rmse_dy": 0.006659936159849167,
      "rmse_mean": 0.01004846766591072,
      "rotation_flip": 0.004698512144386768,
      "sparse_tokens": 32153.0,
      "step": 7707,
      "turn_loss": 0.07928760349750519,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3581118751161494,
      "grad_norm": 0.5744579434394836,
      "learning_rate": 2.8905043683644875e-06,
      "loss": 0.0824,
      "mae_dtheta": 0.010745654813945293,
      "mae_dx": 0.0017630576621741056,
      "mae_dy": 0.002499527530744672,
      "pose_mae_dtheta": 0.070162333548069,
      "pose_mae_dx": 0.020301051437854767,
      "pose_mae_dy": 0.024874679744243622,
      "pose_rmse_dtheta": 0.1686137169599533,
      "pose_rmse_dx": 0.05289137735962868,
      "pose_rmse_dy": 0.05883575603365898,
      "pose_rmse_mean": 0.09344695508480072,
      "rmse_dtheta": 0.023519104346632957,
      "rmse_dx": 0.005609983578324318,
      "rmse_dy": 0.006614443380385637,
      "rmse_mean": 0.011914510279893875,
      "rotation_flip": 0.007572737988084555,
      "sparse_tokens": 32137.0,
      "step": 7708,
      "turn_loss": 0.0871763527393341,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.35815833488199217,
      "grad_norm": 0.6340277791023254,
      "learning_rate": 2.8893056617119004e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.00534800672903657,
      "mae_dx": 0.0010869562393054366,
      "mae_dy": 0.0006761532858945429,
      "pose_mae_dtheta": 0.040451742708683014,
      "pose_mae_dx": 0.01028712559491396,
      "pose_mae_dy": 0.010424859821796417,
      "pose_rmse_dtheta": 0.1599281281232834,
      "pose_rmse_dx": 0.02816544845700264,
      "pose_rmse_dy": 0.02676919661462307,
      "pose_rmse_mean": 0.07162092626094818,
      "rmse_dtheta": 0.01816243678331375,
      "rmse_dx": 0.0041142357513308525,
      "rmse_dy": 0.0015493131941184402,
      "rmse_mean": 0.00794199574738741,
      "rotation_flip": 0.0005115089588798583,
      "sparse_tokens": 32121.0,
      "step": 7709,
      "turn_loss": 0.04122486338019371,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.358204794647835,
      "grad_norm": 0.36891797184944153,
      "learning_rate": 2.8881071026612994e-06,
      "loss": 0.074,
      "mae_dtheta": 0.008127802051603794,
      "mae_dx": 0.0014083879068493843,
      "mae_dy": 0.0005941449198871851,
      "pose_mae_dtheta": 0.05929522216320038,
      "pose_mae_dx": 0.010869133286178112,
      "pose_mae_dy": 0.005473886150866747,
      "pose_rmse_dtheta": 0.23200276494026184,
      "pose_rmse_dx": 0.025349462404847145,
      "pose_rmse_dy": 0.011386365629732609,
      "pose_rmse_mean": 0.08957953751087189,
      "rmse_dtheta": 0.028414158150553703,
      "rmse_dx": 0.003825470572337508,
      "rmse_dy": 0.0017011124873533845,
      "rmse_mean": 0.011313579976558685,
      "rotation_flip": 0.0023419202771037817,
      "sparse_tokens": 32201.0,
      "step": 7710,
      "turn_loss": 0.0614931546151638,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.3582512544136778,
      "grad_norm": 0.7412659525871277,
      "learning_rate": 2.886908691296504e-06,
      "loss": 0.1447,
      "mae_dtheta": 0.025320565328001976,
      "mae_dx": 0.007521192077547312,
      "mae_dy": 0.005536854267120361,
      "pose_mae_dtheta": 0.18639041483402252,
      "pose_mae_dx": 0.06322260946035385,
      "pose_mae_dy": 0.05698711425065994,
      "pose_rmse_dtheta": 0.319906085729599,
      "pose_rmse_dx": 0.12212705612182617,
      "pose_rmse_dy": 0.12811890244483948,
      "pose_rmse_mean": 0.19005069136619568,
      "rmse_dtheta": 0.04042908549308777,
      "rmse_dx": 0.015647638589143753,
      "rmse_dy": 0.01045233104377985,
      "rmse_mean": 0.022176353260874748,
      "rotation_flip": 0.01075268816202879,
      "sparse_tokens": 15552.0,
      "step": 7711,
      "turn_loss": 0.20866253972053528,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.35829771417952055,
      "grad_norm": 0.6912147998809814,
      "learning_rate": 2.8857104277013157e-06,
      "loss": 0.1297,
      "mae_dtheta": 0.027009187266230583,
      "mae_dx": 0.010181347839534283,
      "mae_dy": 0.009160471148788929,
      "pose_mae_dtheta": 0.22977785766124725,
      "pose_mae_dx": 0.09907054901123047,
      "pose_mae_dy": 0.1570712924003601,
      "pose_rmse_dtheta": 0.4138934910297394,
      "pose_rmse_dx": 0.2523816227912903,
      "pose_rmse_dy": 0.2921106219291687,
      "pose_rmse_mean": 0.3194619417190552,
      "rmse_dtheta": 0.04305722191929817,
      "rmse_dx": 0.024620914831757545,
      "rmse_dy": 0.015828147530555725,
      "rmse_mean": 0.027835428714752197,
      "rotation_flip": 0.016806723549962044,
      "sparse_tokens": 3817.0,
      "step": 7712,
      "turn_loss": 0.24104419350624084,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 2946.0,
      "epoch": 0.35834417394536333,
      "grad_norm": 0.6455707550048828,
      "learning_rate": 2.884512311959532e-06,
      "loss": 0.1224,
      "mae_dtheta": 0.033507317304611206,
      "mae_dx": 0.0074145616963505745,
      "mae_dy": 0.0091023501008749,
      "pose_mae_dtheta": 0.287051796913147,
      "pose_mae_dx": 0.09204556047916412,
      "pose_mae_dy": 0.17689473927021027,
      "pose_rmse_dtheta": 0.47046947479248047,
      "pose_rmse_dx": 0.1898464411497116,
      "pose_rmse_dy": 0.3193264901638031,
      "pose_rmse_mean": 0.3265474736690521,
      "rmse_dtheta": 0.04936149716377258,
      "rmse_dx": 0.018955299630761147,
      "rmse_dy": 0.014407521113753319,
      "rmse_mean": 0.027574773877859116,
      "rotation_flip": 0.009433962404727936,
      "sparse_tokens": 2592.0,
      "step": 7713,
      "turn_loss": 0.25773242115974426,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3583906337112061,
      "grad_norm": 0.4931447505950928,
      "learning_rate": 2.8833143441549405e-06,
      "loss": 0.0749,
      "mae_dtheta": 0.007192839868366718,
      "mae_dx": 0.0017343350918963552,
      "mae_dy": 0.001152148935943842,
      "pose_mae_dtheta": 0.046070538461208344,
      "pose_mae_dx": 0.015160566195845604,
      "pose_mae_dy": 0.015088937245309353,
      "pose_rmse_dtheta": 0.13773368299007416,
      "pose_rmse_dx": 0.039119865745306015,
      "pose_rmse_dy": 0.03705223277211189,
      "pose_rmse_mean": 0.07130192965269089,
      "rmse_dtheta": 0.02021777257323265,
      "rmse_dx": 0.005755321122705936,
      "rmse_dy": 0.003026891266927123,
      "rmse_mean": 0.009666661731898785,
      "rotation_flip": 0.0010928962146863341,
      "sparse_tokens": 32121.0,
      "step": 7714,
      "turn_loss": 0.06198221817612648,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3584370934770489,
      "grad_norm": 0.6655629277229309,
      "learning_rate": 2.88211652437131e-06,
      "loss": 0.1621,
      "mae_dtheta": 0.010179083794355392,
      "mae_dx": 0.0020204687025398016,
      "mae_dy": 0.0022614796180278063,
      "pose_mae_dtheta": 0.06148555129766464,
      "pose_mae_dx": 0.02382914163172245,
      "pose_mae_dy": 0.026491807773709297,
      "pose_rmse_dtheta": 0.13837237656116486,
      "pose_rmse_dx": 0.06572357565164566,
      "pose_rmse_dy": 0.06443338096141815,
      "pose_rmse_mean": 0.08950978517532349,
      "rmse_dtheta": 0.020943626761436462,
      "rmse_dx": 0.0065684327855706215,
      "rmse_dy": 0.004791763611137867,
      "rmse_mean": 0.010767940431833267,
      "rotation_flip": 0.004735596012324095,
      "sparse_tokens": 32121.0,
      "step": 7715,
      "turn_loss": 0.10257741063833237,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.35848355324289166,
      "grad_norm": 0.7299764156341553,
      "learning_rate": 2.8809188526924105e-06,
      "loss": 0.0766,
      "mae_dtheta": 0.04145186394453049,
      "mae_dx": 0.01047904696315527,
      "mae_dy": 0.005983865819871426,
      "pose_mae_dtheta": 0.3304646909236908,
      "pose_mae_dx": 0.08131147921085358,
      "pose_mae_dy": 0.07577656954526901,
      "pose_rmse_dtheta": 0.606666624546051,
      "pose_rmse_dx": 0.1451551467180252,
      "pose_rmse_dy": 0.15128135681152344,
      "pose_rmse_mean": 0.3010343909263611,
      "rmse_dtheta": 0.06329484283924103,
      "rmse_dx": 0.021396545693278313,
      "rmse_dy": 0.010868482291698456,
      "rmse_mean": 0.031853292137384415,
      "rotation_flip": 0.004651162773370743,
      "sparse_tokens": 3842.0,
      "step": 7716,
      "turn_loss": 0.3100760281085968,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35853001300873444,
      "grad_norm": 0.6410306692123413,
      "learning_rate": 2.8797213292019927e-06,
      "loss": 0.1762,
      "mae_dtheta": 0.011637608520686626,
      "mae_dx": 0.0023109770845621824,
      "mae_dy": 0.001972232712432742,
      "pose_mae_dtheta": 0.08310059458017349,
      "pose_mae_dx": 0.026084398850798607,
      "pose_mae_dy": 0.027402766048908234,
      "pose_rmse_dtheta": 0.2232121378183365,
      "pose_rmse_dx": 0.06818033009767532,
      "pose_rmse_dy": 0.07995304465293884,
      "pose_rmse_mean": 0.12378184497356415,
      "rmse_dtheta": 0.028058862313628197,
      "rmse_dx": 0.007219779305160046,
      "rmse_dy": 0.0061133247800171375,
      "rmse_mean": 0.013797322288155556,
      "rotation_flip": 0.003610108280554414,
      "sparse_tokens": 32089.0,
      "step": 7717,
      "turn_loss": 0.08933302015066147,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3585764727745772,
      "grad_norm": 0.4955417215824127,
      "learning_rate": 2.8785239539837983e-06,
      "loss": 0.0798,
      "mae_dtheta": 0.006947936490178108,
      "mae_dx": 0.0019886011723428965,
      "mae_dy": 0.0013163131661713123,
      "pose_mae_dtheta": 0.04722663760185242,
      "pose_mae_dx": 0.02217656560242176,
      "pose_mae_dy": 0.01712905429303646,
      "pose_rmse_dtheta": 0.13350459933280945,
      "pose_rmse_dx": 0.06622616201639175,
      "pose_rmse_dy": 0.039151933044195175,
      "pose_rmse_mean": 0.07962756603956223,
      "rmse_dtheta": 0.018942972645163536,
      "rmse_dx": 0.006370263639837503,
      "rmse_dy": 0.0030175826977938414,
      "rmse_mean": 0.009443606249988079,
      "rotation_flip": 0.0030800821259617805,
      "sparse_tokens": 32121.0,
      "step": 7718,
      "turn_loss": 0.061143796890974045,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.35862293254042,
      "grad_norm": 0.456786572933197,
      "learning_rate": 2.8773267271215645e-06,
      "loss": 0.118,
      "mae_dtheta": 0.009003433398902416,
      "mae_dx": 0.0015243437374010682,
      "mae_dy": 0.0019119111821055412,
      "pose_mae_dtheta": 0.0626373440027237,
      "pose_mae_dx": 0.018745578825473785,
      "pose_mae_dy": 0.023499518632888794,
      "pose_rmse_dtheta": 0.15683844685554504,
      "pose_rmse_dx": 0.04435815289616585,
      "pose_rmse_dy": 0.05389740690588951,
      "pose_rmse_mean": 0.08503133058547974,
      "rmse_dtheta": 0.019706986844539642,
      "rmse_dx": 0.004190229345113039,
      "rmse_dy": 0.004294122103601694,
      "rmse_mean": 0.009397112764418125,
      "rotation_flip": 0.005689900368452072,
      "sparse_tokens": 32169.0,
      "step": 7719,
      "turn_loss": 0.0718509703874588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.35866939230626277,
      "grad_norm": 0.5852933526039124,
      "learning_rate": 2.8761296486990104e-06,
      "loss": 0.1286,
      "mae_dtheta": 0.04021570459008217,
      "mae_dx": 0.01257248129695654,
      "mae_dy": 0.006682069040834904,
      "pose_mae_dtheta": 0.3487699031829834,
      "pose_mae_dx": 0.10954954475164413,
      "pose_mae_dy": 0.08645781874656677,
      "pose_rmse_dtheta": 0.5946460962295532,
      "pose_rmse_dx": 0.21938835084438324,
      "pose_rmse_dy": 0.18620926141738892,
      "pose_rmse_mean": 0.33341455459594727,
      "rmse_dtheta": 0.05825922265648842,
      "rmse_dx": 0.024487057700753212,
      "rmse_dy": 0.012356385588645935,
      "rmse_mean": 0.03170089051127434,
      "rotation_flip": 0.016736401244997978,
      "sparse_tokens": 15115.0,
      "step": 7720,
      "turn_loss": 0.2968411445617676,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.35871585207210555,
      "grad_norm": 0.640751838684082,
      "learning_rate": 2.8749327187998516e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.00925381574779749,
      "mae_dx": 0.0017030067974701524,
      "mae_dy": 0.0017147635808214545,
      "pose_mae_dtheta": 0.06271681934595108,
      "pose_mae_dx": 0.01670154556632042,
      "pose_mae_dy": 0.015128372237086296,
      "pose_rmse_dtheta": 0.20723633468151093,
      "pose_rmse_dx": 0.04108232259750366,
      "pose_rmse_dy": 0.04013224318623543,
      "pose_rmse_mean": 0.09615030139684677,
      "rmse_dtheta": 0.026286408305168152,
      "rmse_dx": 0.004732780158519745,
      "rmse_dy": 0.005369223188608885,
      "rmse_mean": 0.012129470705986023,
      "rotation_flip": 0.0020798668265342712,
      "sparse_tokens": 32169.0,
      "step": 7721,
      "turn_loss": 0.08115068823099136,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3587623118379483,
      "grad_norm": 0.4154168367385864,
      "learning_rate": 2.873735937507786e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.011526470072567463,
      "mae_dx": 0.0015068207867443562,
      "mae_dy": 0.0024437124375253916,
      "pose_mae_dtheta": 0.07773442566394806,
      "pose_mae_dx": 0.02143746241927147,
      "pose_mae_dy": 0.02884746342897415,
      "pose_rmse_dtheta": 0.19548016786575317,
      "pose_rmse_dx": 0.0531923733651638,
      "pose_rmse_dy": 0.06406395137310028,
      "pose_rmse_mean": 0.10424550622701645,
      "rmse_dtheta": 0.02467256598174572,
      "rmse_dx": 0.005474406760185957,
      "rmse_dy": 0.005645588506013155,
      "rmse_mean": 0.011930854991078377,
      "rotation_flip": 0.0028860028833150864,
      "sparse_tokens": 32089.0,
      "step": 7722,
      "turn_loss": 0.08731803297996521,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3588087716037911,
      "grad_norm": 0.3996306359767914,
      "learning_rate": 2.8725393049065098e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.010819945484399796,
      "mae_dx": 0.001351346611045301,
      "mae_dy": 0.0016164735425263643,
      "pose_mae_dtheta": 0.07575590908527374,
      "pose_mae_dx": 0.01834906078875065,
      "pose_mae_dy": 0.020915282890200615,
      "pose_rmse_dtheta": 0.2494295835494995,
      "pose_rmse_dx": 0.04708883538842201,
      "pose_rmse_dy": 0.05633660405874252,
      "pose_rmse_mean": 0.11761834472417831,
      "rmse_dtheta": 0.028025656938552856,
      "rmse_dx": 0.004102942533791065,
      "rmse_dy": 0.004530218429863453,
      "rmse_mean": 0.012219605967402458,
      "rotation_flip": 0.001347708865068853,
      "sparse_tokens": 32105.0,
      "step": 7723,
      "turn_loss": 0.06466104090213776,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.3588552313696339,
      "grad_norm": 0.49145689606666565,
      "learning_rate": 2.8713428210797e-06,
      "loss": 0.1607,
      "mae_dtheta": 0.031613077968358994,
      "mae_dx": 0.013947926461696625,
      "mae_dy": 0.006369494833052158,
      "pose_mae_dtheta": 0.25316643714904785,
      "pose_mae_dx": 0.12796275317668915,
      "pose_mae_dy": 0.09755013138055801,
      "pose_rmse_dtheta": 0.4233328104019165,
      "pose_rmse_dx": 0.25952383875846863,
      "pose_rmse_dy": 0.21350502967834473,
      "pose_rmse_mean": 0.2987872362136841,
      "rmse_dtheta": 0.048056237399578094,
      "rmse_dx": 0.027672959491610527,
      "rmse_dy": 0.012513631954789162,
      "rmse_mean": 0.029414277523756027,
      "rotation_flip": 0.012707722373306751,
      "sparse_tokens": 20459.0,
      "step": 7724,
      "turn_loss": 0.2675950527191162,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.35890169113547665,
      "grad_norm": 0.5525277256965637,
      "learning_rate": 2.8701464861110296e-06,
      "loss": 0.1593,
      "mae_dtheta": 0.02642950974404812,
      "mae_dx": 0.01166476309299469,
      "mae_dy": 0.011267604306340218,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.552527666091919,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 144.2664794921875,
      "model/head/act_norm_mean": 98.39935857599431,
      "model/head/act_norm_min": 62.26777267456055,
      "model/head/act_over_embed": 67.62096044273248,
      "model/head/grad_frac": 0.12143780291080475,
      "model/head/grad_norm": 0.0670977458357811,
      "model/head/grad_zero_frac": 0.0001621258707018569,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6939364346590909,
      "model/head/update_ratio": 0.0011435230262577534,
      "model/head/weight_delta": 9.612373352050781,
      "model/head/weight_delta_rel": 0.1686294972896576,
      "model/head/weight_norm": 58.67633819580078,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42229557037353516,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222297668457031,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4221664071083069,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901602487537246,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07484093308448792,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04135168716311455,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5467051630434783,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013355223927646875,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0791234970092773,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10060456395149231,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96293067932129,
      "model/modality_embedder/grad_frac": 0.07484093308448792,
      "model/modality_embedder/grad_norm": 0.04135168716311455,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5467051630434783,
      "model/modality_embedder/update_ratio": 0.0013355223927646875,
      "model/modality_embedder/weight_delta": 3.0791234970092773,
      "model/modality_embedder/weight_delta_rel": 0.10060456395149231,
      "model/modality_embedder/weight_norm": 30.96293067932129,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.60324096679688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.710520382395384,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.451308250427246,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.606882226023798,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07261323183774948,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.040120817720890045,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014369651908054948,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.560112476348877,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09329204261302948,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.920522689819336,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.9561767578125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.521919811958874,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.573004722595215,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.164483510460972,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07413246482610703,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04096023738384247,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.00137886602897197,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.248020648956299,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11251397430896759,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.705739974975586,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.69298553466797,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.184422348484848,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.170967102050781,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.30697081815559,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07680729031562805,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04243815317749977,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013835838763043284,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5090928077697754,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11782876402139664,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.672626495361328,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.64900207519531,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.27094606782107,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.30453109741211,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.74084945242627,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07263791561126709,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04013445973396301,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013422634219750762,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.004852771759033,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10269160568714142,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.900583267211914,
      "model/normalizer/grad_frac": 0.2688598930835724,
      "model/normalizer/grad_norm": 0.1485525220632553,
      "model/normalizer/grad_zero_frac": 0.00021507639030460268,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018903586314991117,
      "model/normalizer/weight_delta": 6.344746112823486,
      "model/normalizer/weight_delta_rel": 0.08171665668487549,
      "model/normalizer/weight_norm": 78.58430480957031,
      "pose_mae_dtheta": 0.17015290260314941,
      "pose_mae_dx": 0.10102356970310211,
      "pose_mae_dy": 0.10135597735643387,
      "pose_rmse_dtheta": 0.29876279830932617,
      "pose_rmse_dx": 0.22480081021785736,
      "pose_rmse_dy": 0.25160813331604004,
      "pose_rmse_mean": 0.2583906054496765,
      "rmse_dtheta": 0.04373834282159805,
      "rmse_dx": 0.023588720709085464,
      "rmse_dy": 0.024698477238416672,
      "rmse_mean": 0.030675183981657028,
      "rotation_flip": 0.0253521129488945,
      "sparse_tokens": 6177.0,
      "step": 7725,
      "turn_loss": 0.37723004817962646,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3589481509013195,
      "grad_norm": 0.5200667977333069,
      "learning_rate": 2.86895030008416e-06,
      "loss": 0.0868,
      "mae_dtheta": 0.0045302617363631725,
      "mae_dx": 0.0017071757465600967,
      "mae_dy": 0.00021226928220130503,
      "pose_mae_dtheta": 0.03266631066799164,
      "pose_mae_dx": 0.014454565942287445,
      "pose_mae_dy": 0.0029639769345521927,
      "pose_rmse_dtheta": 0.1667448878288269,
      "pose_rmse_dx": 0.04983069375157356,
      "pose_rmse_dy": 0.006766392849385738,
      "pose_rmse_mean": 0.07444732636213303,
      "rmse_dtheta": 0.020098356530070305,
      "rmse_dx": 0.0059194439090788364,
      "rmse_dy": 0.0004520190123002976,
      "rmse_mean": 0.008823273703455925,
      "rotation_flip": 0.007017544005066156,
      "sparse_tokens": 32089.0,
      "step": 7726,
      "turn_loss": 0.03590784966945648,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.35899461066716226,
      "grad_norm": 0.5253106951713562,
      "learning_rate": 2.8677542630827383e-06,
      "loss": 0.1067,
      "mae_dtheta": 0.007361401803791523,
      "mae_dx": 0.0015504267066717148,
      "mae_dy": 0.0016610404709354043,
      "pose_mae_dtheta": 0.049791283905506134,
      "pose_mae_dx": 0.018270032480359077,
      "pose_mae_dy": 0.0187138170003891,
      "pose_rmse_dtheta": 0.13469244539737701,
      "pose_rmse_dx": 0.04614587500691414,
      "pose_rmse_dy": 0.05245885252952576,
      "pose_rmse_mean": 0.07776572555303574,
      "rmse_dtheta": 0.01799379661679268,
      "rmse_dx": 0.003851579502224922,
      "rmse_dy": 0.004165061749517918,
      "rmse_mean": 0.008670146577060223,
      "rotation_flip": 0.00295748608186841,
      "sparse_tokens": 32233.0,
      "step": 7727,
      "turn_loss": 0.06276119500398636,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.35904107043300504,
      "grad_norm": 0.6233165264129639,
      "learning_rate": 2.8665583751904068e-06,
      "loss": 0.1248,
      "mae_dtheta": 0.038820184767246246,
      "mae_dx": 0.009356983006000519,
      "mae_dy": 0.008709250018000603,
      "pose_mae_dtheta": 0.2794044613838196,
      "pose_mae_dx": 0.06449423730373383,
      "pose_mae_dy": 0.08161433041095734,
      "pose_rmse_dtheta": 0.5220416784286499,
      "pose_rmse_dx": 0.12017950415611267,
      "pose_rmse_dy": 0.1819208413362503,
      "pose_rmse_mean": 0.27471402287483215,
      "rmse_dtheta": 0.05662091076374054,
      "rmse_dx": 0.018953688442707062,
      "rmse_dy": 0.017473582178354263,
      "rmse_mean": 0.031016062945127487,
      "rotation_flip": 0.031712472438812256,
      "sparse_tokens": 7632.0,
      "step": 7728,
      "turn_loss": 0.2573668658733368,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3590875301988478,
      "grad_norm": 0.7961152195930481,
      "learning_rate": 2.8653626364907918e-06,
      "loss": 0.1626,
      "mae_dtheta": 0.009678937494754791,
      "mae_dx": 0.0018496026750653982,
      "mae_dy": 0.002613456454128027,
      "pose_mae_dtheta": 0.05868520960211754,
      "pose_mae_dx": 0.0259118489921093,
      "pose_mae_dy": 0.02345815859735012,
      "pose_rmse_dtheta": 0.14880703389644623,
      "pose_rmse_dx": 0.07555078715085983,
      "pose_rmse_dy": 0.056560613214969635,
      "pose_rmse_mean": 0.09363947808742523,
      "rmse_dtheta": 0.02201426960527897,
      "rmse_dx": 0.004943911451846361,
      "rmse_dy": 0.006671520881354809,
      "rmse_mean": 0.011209900490939617,
      "rotation_flip": 0.0018719580257311463,
      "sparse_tokens": 32137.0,
      "step": 7729,
      "turn_loss": 0.08241106569766998,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.3591339899646906,
      "grad_norm": 1.1994208097457886,
      "learning_rate": 2.864167047067515e-06,
      "loss": 0.2762,
      "mae_dtheta": 0.03501308709383011,
      "mae_dx": 0.012877211906015873,
      "mae_dy": 0.0063715726137161255,
      "pose_mae_dtheta": 0.24984964728355408,
      "pose_mae_dx": 0.09771657735109329,
      "pose_mae_dy": 0.07740076631307602,
      "pose_rmse_dtheta": 0.46795716881752014,
      "pose_rmse_dx": 0.2059674710035324,
      "pose_rmse_dy": 0.18171504139900208,
      "pose_rmse_mean": 0.2852132320404053,
      "rmse_dtheta": 0.05330264940857887,
      "rmse_dx": 0.02715083584189415,
      "rmse_dy": 0.01314425840973854,
      "rmse_mean": 0.031199246644973755,
      "rotation_flip": 0.01645692251622677,
      "sparse_tokens": 19725.0,
      "step": 7730,
      "turn_loss": 0.2927079200744629,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.35918044973053337,
      "grad_norm": 0.5061612129211426,
      "learning_rate": 2.862971607004181e-06,
      "loss": 0.1053,
      "mae_dtheta": 0.03668335825204849,
      "mae_dx": 0.01059352420270443,
      "mae_dy": 0.0061333575285971165,
      "pose_mae_dtheta": 0.3130790889263153,
      "pose_mae_dx": 0.10201855003833771,
      "pose_mae_dy": 0.07354551553726196,
      "pose_rmse_dtheta": 0.5317685008049011,
      "pose_rmse_dx": 0.225106343626976,
      "pose_rmse_dy": 0.1551697999238968,
      "pose_rmse_mean": 0.3040148913860321,
      "rmse_dtheta": 0.05472118780016899,
      "rmse_dx": 0.02260913886129856,
      "rmse_dy": 0.012153222225606441,
      "rmse_mean": 0.029827851802110672,
      "rotation_flip": 0.013501349836587906,
      "sparse_tokens": 19807.0,
      "step": 7731,
      "turn_loss": 0.26907113194465637,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.35922690949637615,
      "grad_norm": 0.5196694135665894,
      "learning_rate": 2.8617763163843894e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.027854280546307564,
      "mae_dx": 0.01672384701669216,
      "mae_dy": 0.00886199064552784,
      "pose_mae_dtheta": 0.1933584213256836,
      "pose_mae_dx": 0.1226634681224823,
      "pose_mae_dy": 0.10427694022655487,
      "pose_rmse_dtheta": 0.29830673336982727,
      "pose_rmse_dx": 0.2815723419189453,
      "pose_rmse_dy": 0.21158742904663086,
      "pose_rmse_mean": 0.26382216811180115,
      "rmse_dtheta": 0.038953885436058044,
      "rmse_dx": 0.0319313146173954,
      "rmse_dy": 0.014600108377635479,
      "rmse_mean": 0.028495101258158684,
      "rotation_flip": 0.010362694039940834,
      "sparse_tokens": 3755.0,
      "step": 7732,
      "turn_loss": 0.298217236995697,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.3592733692622189,
      "grad_norm": 0.684594988822937,
      "learning_rate": 2.86058117529173e-06,
      "loss": 0.2354,
      "mae_dtheta": 0.032856084406375885,
      "mae_dx": 0.011022539809346199,
      "mae_dy": 0.00867416337132454,
      "pose_mae_dtheta": 0.2287166863679886,
      "pose_mae_dx": 0.09745064377784729,
      "pose_mae_dy": 0.11370966583490372,
      "pose_rmse_dtheta": 0.3787032961845398,
      "pose_rmse_dx": 0.22022058069705963,
      "pose_rmse_dy": 0.23192748427391052,
      "pose_rmse_mean": 0.2769504487514496,
      "rmse_dtheta": 0.04718804731965065,
      "rmse_dx": 0.024766959249973297,
      "rmse_dy": 0.015824416652321815,
      "rmse_mean": 0.029259808361530304,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 11457.0,
      "step": 7733,
      "turn_loss": 0.32060307264328003,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.3593198290280617,
      "grad_norm": 0.4343019127845764,
      "learning_rate": 2.8593861838097746e-06,
      "loss": 0.1568,
      "mae_dtheta": 0.008534802123904228,
      "mae_dx": 0.0014815020840615034,
      "mae_dy": 0.0014893861953169107,
      "pose_mae_dtheta": 0.05792098119854927,
      "pose_mae_dx": 0.018348652869462967,
      "pose_mae_dy": 0.021154996007680893,
      "pose_rmse_dtheta": 0.17955182492733002,
      "pose_rmse_dx": 0.05016138404607773,
      "pose_rmse_dy": 0.04975419119000435,
      "pose_rmse_mean": 0.09315580129623413,
      "rmse_dtheta": 0.02102806232869625,
      "rmse_dx": 0.005521396175026894,
      "rmse_dy": 0.003190417308360338,
      "rmse_mean": 0.009913291782140732,
      "rotation_flip": 0.006191950291395187,
      "sparse_tokens": 32025.0,
      "step": 7734,
      "turn_loss": 0.06456207484006882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3593662887939045,
      "grad_norm": 0.6398965716362,
      "learning_rate": 2.8581913420220954e-06,
      "loss": 0.1927,
      "mae_dtheta": 0.012461913749575615,
      "mae_dx": 0.0028297186363488436,
      "mae_dy": 0.0031288154423236847,
      "pose_mae_dtheta": 0.08530116826295853,
      "pose_mae_dx": 0.023599890992045403,
      "pose_mae_dy": 0.025251835584640503,
      "pose_rmse_dtheta": 0.2368423342704773,
      "pose_rmse_dx": 0.056434981524944305,
      "pose_rmse_dy": 0.05669080466032028,
      "pose_rmse_mean": 0.11665605008602142,
      "rmse_dtheta": 0.029270626604557037,
      "rmse_dx": 0.010370928794145584,
      "rmse_dy": 0.008052135817706585,
      "rmse_mean": 0.015897898003458977,
      "rotation_flip": 0.008130080997943878,
      "sparse_tokens": 32153.0,
      "step": 7735,
      "turn_loss": 0.1159030944108963,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.35941274855974725,
      "grad_norm": 0.613510012626648,
      "learning_rate": 2.8569966500122424e-06,
      "loss": 0.1538,
      "mae_dtheta": 0.03069726750254631,
      "mae_dx": 0.010862557217478752,
      "mae_dy": 0.002239308087155223,
      "pose_mae_dtheta": 0.2369789481163025,
      "pose_mae_dx": 0.08280661702156067,
      "pose_mae_dy": 0.027628803625702858,
      "pose_rmse_dtheta": 0.4262874126434326,
      "pose_rmse_dx": 0.18838125467300415,
      "pose_rmse_dy": 0.06536873430013657,
      "pose_rmse_mean": 0.22667913138866425,
      "rmse_dtheta": 0.0482759028673172,
      "rmse_dx": 0.022453490644693375,
      "rmse_dy": 0.0058417231775820255,
      "rmse_mean": 0.025523705407977104,
      "rotation_flip": 0.00654664495959878,
      "sparse_tokens": 10060.0,
      "step": 7736,
      "turn_loss": 0.2295219749212265,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.35945920832559003,
      "grad_norm": 0.5780353546142578,
      "learning_rate": 2.855802107863766e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.006022337824106216,
      "mae_dx": 0.0009664730168879032,
      "mae_dy": 0.0009821875719353557,
      "pose_mae_dtheta": 0.04054981470108032,
      "pose_mae_dx": 0.011168130673468113,
      "pose_mae_dy": 0.015384744852781296,
      "pose_rmse_dtheta": 0.11993790417909622,
      "pose_rmse_dx": 0.025370759889483452,
      "pose_rmse_dy": 0.0377444289624691,
      "pose_rmse_mean": 0.06101769953966141,
      "rmse_dtheta": 0.016995567828416824,
      "rmse_dx": 0.003048404585570097,
      "rmse_dy": 0.002164252568036318,
      "rmse_mean": 0.007402741815894842,
      "rotation_flip": 0.001349527621641755,
      "sparse_tokens": 32121.0,
      "step": 7737,
      "turn_loss": 0.0502261258661747,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.3595056680914328,
      "grad_norm": 0.4229263663291931,
      "learning_rate": 2.854607715660197e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.033096905797719955,
      "mae_dx": 0.01484554074704647,
      "mae_dy": 0.004403689876198769,
      "pose_mae_dtheta": 0.24260088801383972,
      "pose_mae_dx": 0.11859845370054245,
      "pose_mae_dy": 0.059727057814598083,
      "pose_rmse_dtheta": 0.40435725450515747,
      "pose_rmse_dx": 0.2674090266227722,
      "pose_rmse_dy": 0.13629873096942902,
      "pose_rmse_mean": 0.26935499906539917,
      "rmse_dtheta": 0.04887128993868828,
      "rmse_dx": 0.02961728721857071,
      "rmse_dy": 0.00795794278383255,
      "rmse_mean": 0.028815506026148796,
      "rotation_flip": 0.02319587580859661,
      "sparse_tokens": 26761.0,
      "step": 7738,
      "turn_loss": 0.2712947726249695,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 33089.0,
      "epoch": 0.3595521278572756,
      "grad_norm": 0.7462862730026245,
      "learning_rate": 2.853413473485062e-06,
      "loss": 0.2853,
      "mae_dtheta": 0.033656127750873566,
      "mae_dx": 0.012644080445170403,
      "mae_dy": 0.004922850057482719,
      "pose_mae_dtheta": 0.2622276842594147,
      "pose_mae_dx": 0.09996809810400009,
      "pose_mae_dy": 0.05271284654736519,
      "pose_rmse_dtheta": 0.4495390057563782,
      "pose_rmse_dx": 0.21899771690368652,
      "pose_rmse_dy": 0.14263227581977844,
      "pose_rmse_mean": 0.2703896760940552,
      "rmse_dtheta": 0.04979873448610306,
      "rmse_dx": 0.02445516549050808,
      "rmse_dy": 0.00982216652482748,
      "rmse_mean": 0.02802535705268383,
      "rotation_flip": 0.008916324004530907,
      "sparse_tokens": 24771.0,
      "step": 7739,
      "turn_loss": 0.27827146649360657,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.35959858762311836,
      "grad_norm": 0.606437623500824,
      "learning_rate": 2.8522193814218773e-06,
      "loss": 0.1576,
      "mae_dtheta": 0.023522721603512764,
      "mae_dx": 0.006323468405753374,
      "mae_dy": 0.006799941882491112,
      "pose_mae_dtheta": 0.18123795092105865,
      "pose_mae_dx": 0.05226430296897888,
      "pose_mae_dy": 0.052313078194856644,
      "pose_rmse_dtheta": 0.38745471835136414,
      "pose_rmse_dx": 0.11741574853658676,
      "pose_rmse_dy": 0.12249162793159485,
      "pose_rmse_mean": 0.2091207206249237,
      "rmse_dtheta": 0.043600600212812424,
      "rmse_dx": 0.014460156671702862,
      "rmse_dy": 0.015546421520411968,
      "rmse_mean": 0.024535726755857468,
      "rotation_flip": 0.01126259658485651,
      "sparse_tokens": 32217.0,
      "step": 7740,
      "turn_loss": 0.23528166115283966,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.35964504738896114,
      "grad_norm": 0.5156201720237732,
      "learning_rate": 2.851025439554142e-06,
      "loss": 0.1267,
      "mae_dtheta": 0.028610697016119957,
      "mae_dx": 0.009782219305634499,
      "mae_dy": 0.004117453470826149,
      "pose_mae_dtheta": 0.21736478805541992,
      "pose_mae_dx": 0.0770622193813324,
      "pose_mae_dy": 0.04724886640906334,
      "pose_rmse_dtheta": 0.422255277633667,
      "pose_rmse_dx": 0.18532715737819672,
      "pose_rmse_dy": 0.13880614936351776,
      "pose_rmse_mean": 0.24879620969295502,
      "rmse_dtheta": 0.04784276708960533,
      "rmse_dx": 0.021610191091895103,
      "rmse_dy": 0.011331446468830109,
      "rmse_mean": 0.026928134262561798,
      "rotation_flip": 0.014556040987372398,
      "sparse_tokens": 23833.0,
      "step": 7741,
      "turn_loss": 0.23535498976707458,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3596915071548039,
      "grad_norm": 0.6565255522727966,
      "learning_rate": 2.8498316479653532e-06,
      "loss": 0.1671,
      "mae_dtheta": 0.009515073150396347,
      "mae_dx": 0.0015349842142313719,
      "mae_dy": 0.0020827390253543854,
      "pose_mae_dtheta": 0.06196598336100578,
      "pose_mae_dx": 0.019053839147090912,
      "pose_mae_dy": 0.026070864871144295,
      "pose_rmse_dtheta": 0.1259443759918213,
      "pose_rmse_dx": 0.0451047308743,
      "pose_rmse_dy": 0.05541609600186348,
      "pose_rmse_mean": 0.07548840343952179,
      "rmse_dtheta": 0.018607040867209435,
      "rmse_dx": 0.004844417329877615,
      "rmse_dy": 0.004142561461776495,
      "rmse_mean": 0.009198007173836231,
      "rotation_flip": 0.005535785108804703,
      "sparse_tokens": 32089.0,
      "step": 7742,
      "turn_loss": 0.07615292817354202,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.35973796692064675,
      "grad_norm": 0.6216709017753601,
      "learning_rate": 2.8486380067389885e-06,
      "loss": 0.1593,
      "mae_dtheta": 0.035860005766153336,
      "mae_dx": 0.01212078146636486,
      "mae_dy": 0.00447106035426259,
      "pose_mae_dtheta": 0.2956949770450592,
      "pose_mae_dx": 0.10458482801914215,
      "pose_mae_dy": 0.042107418179512024,
      "pose_rmse_dtheta": 0.48151516914367676,
      "pose_rmse_dx": 0.20880961418151855,
      "pose_rmse_dy": 0.07428847998380661,
      "pose_rmse_mean": 0.25487110018730164,
      "rmse_dtheta": 0.05155020207166672,
      "rmse_dx": 0.02363414317369461,
      "rmse_dy": 0.007987220771610737,
      "rmse_mean": 0.027723856270313263,
      "rotation_flip": 0.0035335689317435026,
      "sparse_tokens": 4862.0,
      "step": 7743,
      "turn_loss": 0.23243963718414307,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3597844266864895,
      "grad_norm": 0.36723896861076355,
      "learning_rate": 2.8474445159585235e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.011331984773278236,
      "mae_dx": 0.0017685077618807554,
      "mae_dy": 0.003456984180957079,
      "pose_mae_dtheta": 0.07246048748493195,
      "pose_mae_dx": 0.02746451273560524,
      "pose_mae_dy": 0.033303238451480865,
      "pose_rmse_dtheta": 0.15242591500282288,
      "pose_rmse_dx": 0.0693250298500061,
      "pose_rmse_dy": 0.06803688406944275,
      "pose_rmse_mean": 0.09659594297409058,
      "rmse_dtheta": 0.021464265882968903,
      "rmse_dx": 0.004715407267212868,
      "rmse_dy": 0.007081862539052963,
      "rmse_mean": 0.011087179183959961,
      "rotation_flip": 0.009061253629624844,
      "sparse_tokens": 32073.0,
      "step": 7744,
      "turn_loss": 0.0932808369398117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3598308864523323,
      "grad_norm": 0.7053897976875305,
      "learning_rate": 2.8462511757074205e-06,
      "loss": 0.1355,
      "mae_dtheta": 0.007964488118886948,
      "mae_dx": 0.00137035280931741,
      "mae_dy": 0.0015520607121288776,
      "pose_mae_dtheta": 0.051226917654275894,
      "pose_mae_dx": 0.015023666433990002,
      "pose_mae_dy": 0.015368357300758362,
      "pose_rmse_dtheta": 0.1770673394203186,
      "pose_rmse_dx": 0.040715549141168594,
      "pose_rmse_dy": 0.034036606550216675,
      "pose_rmse_mean": 0.08393983542919159,
      "rmse_dtheta": 0.022247299551963806,
      "rmse_dx": 0.0047284020110964775,
      "rmse_dy": 0.004154987633228302,
      "rmse_mean": 0.01037689670920372,
      "rotation_flip": 0.004464285913854837,
      "sparse_tokens": 32089.0,
      "step": 7745,
      "turn_loss": 0.05927877873182297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3598773462181751,
      "grad_norm": 0.3794620633125305,
      "learning_rate": 2.8450579860691276e-06,
      "loss": 0.094,
      "mae_dtheta": 0.009918778203427792,
      "mae_dx": 0.0019326918991282582,
      "mae_dy": 0.002451722277328372,
      "pose_mae_dtheta": 0.06445993483066559,
      "pose_mae_dx": 0.024854978546500206,
      "pose_mae_dy": 0.02613918110728264,
      "pose_rmse_dtheta": 0.16916105151176453,
      "pose_rmse_dx": 0.08024239540100098,
      "pose_rmse_dy": 0.06181948632001877,
      "pose_rmse_mean": 0.10374098271131516,
      "rmse_dtheta": 0.02072765678167343,
      "rmse_dx": 0.005862614139914513,
      "rmse_dy": 0.006147847045212984,
      "rmse_mean": 0.010912707075476646,
      "rotation_flip": 0.010935143567621708,
      "sparse_tokens": 32137.0,
      "step": 7746,
      "turn_loss": 0.08376262336969376,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.35992380598401785,
      "grad_norm": 0.6901949048042297,
      "learning_rate": 2.8438649471270876e-06,
      "loss": 0.1583,
      "mae_dtheta": 0.007392441853880882,
      "mae_dx": 0.001472080359235406,
      "mae_dy": 0.0020208454225212336,
      "pose_mae_dtheta": 0.050617534667253494,
      "pose_mae_dx": 0.018958499655127525,
      "pose_mae_dy": 0.02150362730026245,
      "pose_rmse_dtheta": 0.13702704012393951,
      "pose_rmse_dx": 0.04523700475692749,
      "pose_rmse_dy": 0.05488332360982895,
      "pose_rmse_mean": 0.07904912531375885,
      "rmse_dtheta": 0.018303008750081062,
      "rmse_dx": 0.004028577823191881,
      "rmse_dy": 0.005410932935774326,
      "rmse_mean": 0.009247506968677044,
      "rotation_flip": 0.003680160501971841,
      "sparse_tokens": 32201.0,
      "step": 7747,
      "turn_loss": 0.06325142085552216,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.35997026574986063,
      "grad_norm": 0.4197259545326233,
      "learning_rate": 2.8426720589647265e-06,
      "loss": 0.1623,
      "mae_dtheta": 0.012876108288764954,
      "mae_dx": 0.0028289002366364002,
      "mae_dy": 0.004223832860589027,
      "pose_mae_dtheta": 0.08771664649248123,
      "pose_mae_dx": 0.03805263340473175,
      "pose_mae_dy": 0.03486303612589836,
      "pose_rmse_dtheta": 0.21549075841903687,
      "pose_rmse_dx": 0.09491414576768875,
      "pose_rmse_dy": 0.07757765799760818,
      "pose_rmse_mean": 0.12932752072811127,
      "rmse_dtheta": 0.026866648346185684,
      "rmse_dx": 0.007352782879024744,
      "rmse_dy": 0.008778289891779423,
      "rmse_mean": 0.014332573860883713,
      "rotation_flip": 0.00652472535148263,
      "sparse_tokens": 32089.0,
      "step": 7748,
      "turn_loss": 0.1238924190402031,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.3600167255157034,
      "grad_norm": 0.3743326961994171,
      "learning_rate": 2.841479321665469e-06,
      "loss": 0.0837,
      "mae_dtheta": 0.02581055648624897,
      "mae_dx": 0.00906295608729124,
      "mae_dy": 0.004847342148423195,
      "pose_mae_dtheta": 0.19337493181228638,
      "pose_mae_dx": 0.06673990190029144,
      "pose_mae_dy": 0.06851173937320709,
      "pose_rmse_dtheta": 0.3545810282230377,
      "pose_rmse_dx": 0.16976547241210938,
      "pose_rmse_dy": 0.15998607873916626,
      "pose_rmse_mean": 0.22811084985733032,
      "rmse_dtheta": 0.04365873336791992,
      "rmse_dx": 0.02070183865725994,
      "rmse_dy": 0.010533453896641731,
      "rmse_mean": 0.024964675307273865,
      "rotation_flip": 0.013769363053143024,
      "sparse_tokens": 11286.0,
      "step": 7749,
      "turn_loss": 0.24442017078399658,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.3600631852815462,
      "grad_norm": 0.9944203495979309,
      "learning_rate": 2.8402867353127195e-06,
      "loss": 0.2709,
      "mae_dtheta": 0.025749683380126953,
      "mae_dx": 0.0071970075368881226,
      "mae_dy": 0.0022987511474639177,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9944202899932861,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.7293243408203,
      "model/head/act_norm_mean": 110.76692468979779,
      "model/head/act_norm_min": 80.77339935302734,
      "model/head/act_over_embed": 76.12006766311644,
      "model/head/grad_frac": 0.11628056317567825,
      "model/head/grad_norm": 0.11563175171613693,
      "model/head/grad_zero_frac": 0.00018750761228147894,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6882180606617647,
      "model/head/update_ratio": 0.0019706115126609802,
      "model/head/weight_delta": 9.619344711303711,
      "model/head/weight_delta_rel": 0.1687518060207367,
      "model/head/weight_norm": 58.678104400634766,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42225968837738037,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222066334315709,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4221612513065338,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29014435125495447,
      "model/modality_embedder.encoders.pose/grad_frac": 0.03442436084151268,
      "model/modality_embedder.encoders.pose/grad_norm": 0.034232281148433685,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5454241071428572,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011055871145799756,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0795860290527344,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10061967372894287,
      "model/modality_embedder.encoders.pose/weight_norm": 30.962987899780273,
      "model/modality_embedder/grad_frac": 0.03442436084151268,
      "model/modality_embedder/grad_norm": 0.034232281148433685,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5454241071428572,
      "model/modality_embedder/update_ratio": 0.0011055871145799756,
      "model/modality_embedder/weight_delta": 3.0795860290527344,
      "model/modality_embedder/weight_delta_rel": 0.10061967372894287,
      "model/modality_embedder/weight_norm": 30.962987899780273,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.71786499023438,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.663818131419234,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.244881629943848,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.261997364067128,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10723031312227249,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.10663200169801712,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.003818977391347289,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.563821792602539,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09342721104621887,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.921611785888672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.18681335449219,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.514173377684408,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.7684965133667,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.846369450451803,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0921090766787529,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0915951356291771,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.003083248622715473,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2523744106292725,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11266478896141052,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.707345962524414,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.01693725585938,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.185291564542485,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.95206356048584,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.994777513715633,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08420287072658539,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.08373304456472397,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002729740459471941,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5137219429016113,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11798420548439026,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.674360275268555,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.89673614501953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.018054096638654,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.695810317993164,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.254269084365284,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08043395727872849,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07998515665531158,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0026749514508992434,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.008702039718628,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1028231605887413,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.901535034179688,
      "model/normalizer/grad_frac": 0.35987403988838196,
      "model/normalizer/grad_norm": 0.3578660488128662,
      "model/normalizer/grad_zero_frac": 0.00022098507906775922,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004553817678242922,
      "model/normalizer/weight_delta": 6.3531813621521,
      "model/normalizer/weight_delta_rel": 0.08182530105113983,
      "model/normalizer/weight_norm": 78.58594512939453,
      "pose_mae_dtheta": 0.18797342479228973,
      "pose_mae_dx": 0.05258360132575035,
      "pose_mae_dy": 0.028708990663290024,
      "pose_rmse_dtheta": 0.3530358374118805,
      "pose_rmse_dx": 0.14752238988876343,
      "pose_rmse_dy": 0.06413958221673965,
      "pose_rmse_mean": 0.1882326304912567,
      "rmse_dtheta": 0.04277336224913597,
      "rmse_dx": 0.017903272062540054,
      "rmse_dy": 0.005239313002675772,
      "rmse_mean": 0.021971983835101128,
      "rotation_flip": 0.0062500000931322575,
      "sparse_tokens": 8906.0,
      "step": 7750,
      "turn_loss": 0.20182836055755615,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 23618.0,
      "epoch": 0.36010964504738896,
      "grad_norm": 1.0675910711288452,
      "learning_rate": 2.839094299989877e-06,
      "loss": 0.2471,
      "mae_dtheta": 0.03482106700539589,
      "mae_dx": 0.01661532372236252,
      "mae_dy": 0.004206514917314053,
      "pose_mae_dtheta": 0.2805823087692261,
      "pose_mae_dx": 0.13550499081611633,
      "pose_mae_dy": 0.07025434821844101,
      "pose_rmse_dtheta": 0.4934366047382355,
      "pose_rmse_dx": 0.28555503487586975,
      "pose_rmse_dy": 0.16161763668060303,
      "pose_rmse_mean": 0.3135364353656769,
      "rmse_dtheta": 0.05362321808934212,
      "rmse_dx": 0.030907457694411278,
      "rmse_dy": 0.007781947962939739,
      "rmse_mean": 0.03077087365090847,
      "rotation_flip": 0.010582010261714458,
      "sparse_tokens": 17928.0,
      "step": 7751,
      "turn_loss": 0.24436140060424805,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.36015610481323174,
      "grad_norm": 0.3722536563873291,
      "learning_rate": 2.8379020157803323e-06,
      "loss": 0.0822,
      "mae_dtheta": 0.010604897513985634,
      "mae_dx": 0.0016227078158408403,
      "mae_dy": 0.0024847479071468115,
      "pose_mae_dtheta": 0.07017381489276886,
      "pose_mae_dx": 0.025963984429836273,
      "pose_mae_dy": 0.030054807662963867,
      "pose_rmse_dtheta": 0.1782619059085846,
      "pose_rmse_dx": 0.07389844954013824,
      "pose_rmse_dy": 0.08373144268989563,
      "pose_rmse_mean": 0.11196394264698029,
      "rmse_dtheta": 0.022640328854322433,
      "rmse_dx": 0.004990082234144211,
      "rmse_dy": 0.005870374385267496,
      "rmse_mean": 0.011166929267346859,
      "rotation_flip": 0.004918653052300215,
      "sparse_tokens": 32089.0,
      "step": 7752,
      "turn_loss": 0.08307892084121704,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3602025645790745,
      "grad_norm": 0.37555912137031555,
      "learning_rate": 2.8367098827674575e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.006611059419810772,
      "mae_dx": 0.001467888243496418,
      "mae_dy": 0.002094921190291643,
      "pose_mae_dtheta": 0.0459926575422287,
      "pose_mae_dx": 0.020975390449166298,
      "pose_mae_dy": 0.02250634878873825,
      "pose_rmse_dtheta": 0.10638277977705002,
      "pose_rmse_dx": 0.06995469331741333,
      "pose_rmse_dy": 0.060877345502376556,
      "pose_rmse_mean": 0.07907161116600037,
      "rmse_dtheta": 0.014521315693855286,
      "rmse_dx": 0.00465184124186635,
      "rmse_dy": 0.005542279686778784,
      "rmse_mean": 0.008238479495048523,
      "rotation_flip": 0.005503810476511717,
      "sparse_tokens": 32089.0,
      "step": 7753,
      "turn_loss": 0.05748705938458443,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.3602490243449173,
      "grad_norm": 1.0733367204666138,
      "learning_rate": 2.8355179010346244e-06,
      "loss": 0.2875,
      "mae_dtheta": 0.039805617183446884,
      "mae_dx": 0.012300802394747734,
      "mae_dy": 0.006134010851383209,
      "pose_mae_dtheta": 0.32640987634658813,
      "pose_mae_dx": 0.10430750995874405,
      "pose_mae_dy": 0.0656304806470871,
      "pose_rmse_dtheta": 0.5432413220405579,
      "pose_rmse_dx": 0.21258415281772614,
      "pose_rmse_dy": 0.14588294923305511,
      "pose_rmse_mean": 0.30056947469711304,
      "rmse_dtheta": 0.056768450886011124,
      "rmse_dx": 0.023609977215528488,
      "rmse_dy": 0.011205403134226799,
      "rmse_mean": 0.03052794560790062,
      "rotation_flip": 0.005819592624902725,
      "sparse_tokens": 17723.0,
      "step": 7754,
      "turn_loss": 0.34741678833961487,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.36029548411076007,
      "grad_norm": 0.5472743511199951,
      "learning_rate": 2.8343260706651864e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.009290368296205997,
      "mae_dx": 0.002272886922582984,
      "mae_dy": 0.001813068287447095,
      "pose_mae_dtheta": 0.06729301065206528,
      "pose_mae_dx": 0.022601669654250145,
      "pose_mae_dy": 0.024996139109134674,
      "pose_rmse_dtheta": 0.1636408418416977,
      "pose_rmse_dx": 0.05445823445916176,
      "pose_rmse_dy": 0.0689443051815033,
      "pose_rmse_mean": 0.09568113088607788,
      "rmse_dtheta": 0.02173875831067562,
      "rmse_dx": 0.006691975053399801,
      "rmse_dy": 0.004319165833294392,
      "rmse_mean": 0.010916633531451225,
      "rotation_flip": 0.003915810026228428,
      "sparse_tokens": 32121.0,
      "step": 7755,
      "turn_loss": 0.08242262154817581,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.36034194387660284,
      "grad_norm": 0.6861356496810913,
      "learning_rate": 2.8331343917424857e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.04149560630321503,
      "mae_dx": 0.010075291618704796,
      "mae_dy": 0.005495406221598387,
      "pose_mae_dtheta": 0.3349856734275818,
      "pose_mae_dx": 0.06547006964683533,
      "pose_mae_dy": 0.05388946831226349,
      "pose_rmse_dtheta": 0.6254503726959229,
      "pose_rmse_dx": 0.13381074368953705,
      "pose_rmse_dy": 0.11655498296022415,
      "pose_rmse_mean": 0.2919387221336365,
      "rmse_dtheta": 0.06270754337310791,
      "rmse_dx": 0.021330876275897026,
      "rmse_dy": 0.009798579849302769,
      "rmse_mean": 0.031279001384973526,
      "rotation_flip": 0.007692307699471712,
      "sparse_tokens": 4186.0,
      "step": 7756,
      "turn_loss": 0.3414234220981598,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 43163.0,
      "epoch": 0.3603884036424456,
      "grad_norm": 0.446469247341156,
      "learning_rate": 2.831942864349863e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.043618347495794296,
      "mae_dx": 0.009131580591201782,
      "mae_dy": 0.004603310953825712,
      "pose_mae_dtheta": 0.33468812704086304,
      "pose_mae_dx": 0.06701210141181946,
      "pose_mae_dy": 0.04817252606153488,
      "pose_rmse_dtheta": 0.5717267394065857,
      "pose_rmse_dx": 0.15124398469924927,
      "pose_rmse_dy": 0.12845772504806519,
      "pose_rmse_mean": 0.28380948305130005,
      "rmse_dtheta": 0.06246079504489899,
      "rmse_dx": 0.019222645089030266,
      "rmse_dy": 0.011087282560765743,
      "rmse_mean": 0.030923575162887573,
      "rotation_flip": 0.012098650448024273,
      "sparse_tokens": 30263.0,
      "step": 7757,
      "turn_loss": 0.3215481638908386,
      "turns": 133.0,
      "turns_per_sample": 133.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3604348634082884,
      "grad_norm": 0.3919065296649933,
      "learning_rate": 2.830751488570637e-06,
      "loss": 0.0854,
      "mae_dtheta": 0.009640115313231945,
      "mae_dx": 0.002401160541921854,
      "mae_dy": 0.0030820516403764486,
      "pose_mae_dtheta": 0.07265988737344742,
      "pose_mae_dx": 0.02505979686975479,
      "pose_mae_dy": 0.02995663695037365,
      "pose_rmse_dtheta": 0.18151313066482544,
      "pose_rmse_dx": 0.07002093642950058,
      "pose_rmse_dy": 0.09020785987377167,
      "pose_rmse_mean": 0.11391397565603256,
      "rmse_dtheta": 0.022284865379333496,
      "rmse_dx": 0.007961728610098362,
      "rmse_dy": 0.009321424178779125,
      "rmse_mean": 0.013189340010285378,
      "rotation_flip": 0.002991453045979142,
      "sparse_tokens": 32089.0,
      "step": 7758,
      "turn_loss": 0.09784255176782608,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.36048132317413123,
      "grad_norm": 0.5202963352203369,
      "learning_rate": 2.829560264488126e-06,
      "loss": 0.1479,
      "mae_dtheta": 0.02656407840549946,
      "mae_dx": 0.007260784041136503,
      "mae_dy": 0.006325091235339642,
      "pose_mae_dtheta": 0.1913905143737793,
      "pose_mae_dx": 0.06423482298851013,
      "pose_mae_dy": 0.07965125888586044,
      "pose_rmse_dtheta": 0.3230523467063904,
      "pose_rmse_dx": 0.1426081359386444,
      "pose_rmse_dy": 0.15597745776176453,
      "pose_rmse_mean": 0.2072126567363739,
      "rmse_dtheta": 0.03990572690963745,
      "rmse_dx": 0.017390066757798195,
      "rmse_dy": 0.010852976702153683,
      "rmse_mean": 0.022716257721185684,
      "rotation_flip": 0.013733905740082264,
      "sparse_tokens": 22383.0,
      "step": 7759,
      "turn_loss": 0.24420377612113953,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.360527782939974,
      "grad_norm": 0.6499073505401611,
      "learning_rate": 2.828369192185628e-06,
      "loss": 0.1748,
      "mae_dtheta": 0.039180245250463486,
      "mae_dx": 0.016682837158441544,
      "mae_dy": 0.010738796554505825,
      "pose_mae_dtheta": 0.34239980578422546,
      "pose_mae_dx": 0.12556082010269165,
      "pose_mae_dy": 0.10914407670497894,
      "pose_rmse_dtheta": 0.5833954811096191,
      "pose_rmse_dx": 0.24523364007472992,
      "pose_rmse_dy": 0.2440698891878128,
      "pose_rmse_mean": 0.35756635665893555,
      "rmse_dtheta": 0.059878814965486526,
      "rmse_dx": 0.02843703329563141,
      "rmse_dy": 0.02052137441933155,
      "rmse_mean": 0.03627907484769821,
      "rotation_flip": 0.006825938355177641,
      "sparse_tokens": 9915.0,
      "step": 7760,
      "turn_loss": 0.36294111609458923,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3605742427058168,
      "grad_norm": 0.611825704574585,
      "learning_rate": 2.8271782717464413e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.010297883301973343,
      "mae_dx": 0.0019903972279280424,
      "mae_dy": 0.002701426623389125,
      "pose_mae_dtheta": 0.07346922904253006,
      "pose_mae_dx": 0.026233958080410957,
      "pose_mae_dy": 0.02672610618174076,
      "pose_rmse_dtheta": 0.22383835911750793,
      "pose_rmse_dx": 0.09264048933982849,
      "pose_rmse_dy": 0.06401891261339188,
      "pose_rmse_mean": 0.12683258950710297,
      "rmse_dtheta": 0.02507459744811058,
      "rmse_dx": 0.007687923964112997,
      "rmse_dy": 0.006409569177776575,
      "rmse_mean": 0.013057364150881767,
      "rotation_flip": 0.0031104199588298798,
      "sparse_tokens": 32105.0,
      "step": 7761,
      "turn_loss": 0.0962471142411232,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.36062070247165956,
      "grad_norm": 0.49308547377586365,
      "learning_rate": 2.8259875032538407e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.007516088895499706,
      "mae_dx": 0.0020637535490095615,
      "mae_dy": 0.002955059753730893,
      "pose_mae_dtheta": 0.05188943073153496,
      "pose_mae_dx": 0.027696290984749794,
      "pose_mae_dy": 0.02311943657696247,
      "pose_rmse_dtheta": 0.13563670217990875,
      "pose_rmse_dx": 0.07695464789867401,
      "pose_rmse_dy": 0.05727768316864967,
      "pose_rmse_mean": 0.08995634317398071,
      "rmse_dtheta": 0.017374055460095406,
      "rmse_dx": 0.005145925562828779,
      "rmse_dy": 0.006838073488324881,
      "rmse_mean": 0.00978601910173893,
      "rotation_flip": 0.0038115037605166435,
      "sparse_tokens": 32185.0,
      "step": 7762,
      "turn_loss": 0.06610740721225739,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.36066716223750234,
      "grad_norm": 0.4566819965839386,
      "learning_rate": 2.8247968867911025e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.03765668347477913,
      "mae_dx": 0.012496091425418854,
      "mae_dy": 0.008722931146621704,
      "pose_mae_dtheta": 0.27652716636657715,
      "pose_mae_dx": 0.1057092621922493,
      "pose_mae_dy": 0.08053430169820786,
      "pose_rmse_dtheta": 0.4781437814235687,
      "pose_rmse_dx": 0.23263238370418549,
      "pose_rmse_dy": 0.17558078467845917,
      "pose_rmse_mean": 0.2954523265361786,
      "rmse_dtheta": 0.05646282434463501,
      "rmse_dx": 0.024034403264522552,
      "rmse_dy": 0.01799679920077324,
      "rmse_mean": 0.0328313410282135,
      "rotation_flip": 0.009671179577708244,
      "sparse_tokens": 16236.0,
      "step": 7763,
      "turn_loss": 0.33384808897972107,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3607136220033451,
      "grad_norm": 0.5138564705848694,
      "learning_rate": 2.823606422441486e-06,
      "loss": 0.1244,
      "mae_dtheta": 0.015270384959876537,
      "mae_dx": 0.004224450793117285,
      "mae_dy": 0.004317393526434898,
      "pose_mae_dtheta": 0.10921657085418701,
      "pose_mae_dx": 0.036940693855285645,
      "pose_mae_dy": 0.031156491488218307,
      "pose_rmse_dtheta": 0.2629811465740204,
      "pose_rmse_dx": 0.09636892378330231,
      "pose_rmse_dy": 0.07428199797868729,
      "pose_rmse_mean": 0.14454403519630432,
      "rmse_dtheta": 0.03147873654961586,
      "rmse_dx": 0.010798769071698189,
      "rmse_dy": 0.010181311517953873,
      "rmse_mean": 0.017486274242401123,
      "rotation_flip": 0.007585751824080944,
      "sparse_tokens": 32201.0,
      "step": 7764,
      "turn_loss": 0.15615257620811462,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.3607600817691879,
      "grad_norm": 0.4103098511695862,
      "learning_rate": 2.82241611028824e-06,
      "loss": 0.0698,
      "mae_dtheta": 0.008436042815446854,
      "mae_dx": 0.0014251042157411575,
      "mae_dy": 0.0012898086570203304,
      "pose_mae_dtheta": 0.06282705813646317,
      "pose_mae_dx": 0.015975316986441612,
      "pose_mae_dy": 0.018200304359197617,
      "pose_rmse_dtheta": 0.18975092470645905,
      "pose_rmse_dx": 0.05189259722828865,
      "pose_rmse_dy": 0.0536392405629158,
      "pose_rmse_mean": 0.09842758625745773,
      "rmse_dtheta": 0.021045759320259094,
      "rmse_dx": 0.005126217380166054,
      "rmse_dy": 0.00344147440046072,
      "rmse_mean": 0.009871150366961956,
      "rotation_flip": 0.0022455090656876564,
      "sparse_tokens": 32025.0,
      "step": 7765,
      "turn_loss": 0.06228805333375931,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.36080654153503067,
      "grad_norm": 0.3875066339969635,
      "learning_rate": 2.8212259504146045e-06,
      "loss": 0.1283,
      "mae_dtheta": 0.0083076823502779,
      "mae_dx": 0.00125809945166111,
      "mae_dy": 0.002159329131245613,
      "pose_mae_dtheta": 0.05782443284988403,
      "pose_mae_dx": 0.01819552481174469,
      "pose_mae_dy": 0.02337581478059292,
      "pose_rmse_dtheta": 0.17328792810440063,
      "pose_rmse_dx": 0.05059611797332764,
      "pose_rmse_dy": 0.05429467558860779,
      "pose_rmse_mean": 0.09272624552249908,
      "rmse_dtheta": 0.020266976207494736,
      "rmse_dx": 0.0036973084788769484,
      "rmse_dy": 0.004710933193564415,
      "rmse_mean": 0.009558405727148056,
      "rotation_flip": 0.004068047273904085,
      "sparse_tokens": 32089.0,
      "step": 7766,
      "turn_loss": 0.06763257831335068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.36085300130087344,
      "grad_norm": 0.6269676685333252,
      "learning_rate": 2.8200359429038073e-06,
      "loss": 0.1956,
      "mae_dtheta": 0.03839666768908501,
      "mae_dx": 0.008176293224096298,
      "mae_dy": 0.004143239930272102,
      "pose_mae_dtheta": 0.3379359543323517,
      "pose_mae_dx": 0.06266564130783081,
      "pose_mae_dy": 0.048099227249622345,
      "pose_rmse_dtheta": 0.6114132404327393,
      "pose_rmse_dx": 0.1615990698337555,
      "pose_rmse_dy": 0.10253264009952545,
      "pose_rmse_mean": 0.2918483018875122,
      "rmse_dtheta": 0.060254503041505814,
      "rmse_dx": 0.0193866528570652,
      "rmse_dy": 0.00869021750986576,
      "rmse_mean": 0.029443791136145592,
      "rotation_flip": 0.010943912900984287,
      "sparse_tokens": 12202.0,
      "step": 7767,
      "turn_loss": 0.27001240849494934,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.3608994610667162,
      "grad_norm": 0.5801522731781006,
      "learning_rate": 2.818846087839068e-06,
      "loss": 0.0877,
      "mae_dtheta": 0.028049619868397713,
      "mae_dx": 0.008612080477178097,
      "mae_dy": 0.004875664133578539,
      "pose_mae_dtheta": 0.2341470718383789,
      "pose_mae_dx": 0.08388101309537888,
      "pose_mae_dy": 0.06696493923664093,
      "pose_rmse_dtheta": 0.4372338652610779,
      "pose_rmse_dx": 0.20730209350585938,
      "pose_rmse_dy": 0.160190612077713,
      "pose_rmse_mean": 0.268242210149765,
      "rmse_dtheta": 0.046036530286073685,
      "rmse_dx": 0.020897503942251205,
      "rmse_dy": 0.00983384344726801,
      "rmse_mean": 0.025589292868971825,
      "rotation_flip": 0.016566265374422073,
      "sparse_tokens": 13378.0,
      "step": 7768,
      "turn_loss": 0.17951291799545288,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.360945920832559,
      "grad_norm": 0.5262783765792847,
      "learning_rate": 2.81765638530359e-06,
      "loss": 0.1502,
      "mae_dtheta": 0.033385757356882095,
      "mae_dx": 0.010082412511110306,
      "mae_dy": 0.0057566165924072266,
      "pose_mae_dtheta": 0.23655252158641815,
      "pose_mae_dx": 0.08586442470550537,
      "pose_mae_dy": 0.06673038005828857,
      "pose_rmse_dtheta": 0.4345501661300659,
      "pose_rmse_dx": 0.18586736917495728,
      "pose_rmse_dy": 0.16958999633789062,
      "pose_rmse_mean": 0.26333585381507874,
      "rmse_dtheta": 0.05193260312080383,
      "rmse_dx": 0.021752560511231422,
      "rmse_dy": 0.010829411447048187,
      "rmse_mean": 0.02817152440547943,
      "rotation_flip": 0.00913241971284151,
      "sparse_tokens": 18666.0,
      "step": 7769,
      "turn_loss": 0.31231608986854553,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3609923805984018,
      "grad_norm": 0.41224023699760437,
      "learning_rate": 2.8164668353805725e-06,
      "loss": 0.0858,
      "mae_dtheta": 0.012365061789751053,
      "mae_dx": 0.002070837654173374,
      "mae_dy": 0.00390248722396791,
      "pose_mae_dtheta": 0.08331690728664398,
      "pose_mae_dx": 0.03551260009407997,
      "pose_mae_dy": 0.04284098371863365,
      "pose_rmse_dtheta": 0.16703476011753082,
      "pose_rmse_dx": 0.09876219183206558,
      "pose_rmse_dy": 0.09466186910867691,
      "pose_rmse_mean": 0.12015294283628464,
      "rmse_dtheta": 0.022884702309966087,
      "rmse_dx": 0.005703734699636698,
      "rmse_dy": 0.008545729331672192,
      "rmse_mean": 0.012378055602312088,
      "rotation_flip": 0.009368494153022766,
      "sparse_tokens": 32073.0,
      "step": 7770,
      "turn_loss": 0.11956329643726349,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35578.0,
      "epoch": 0.36103884036424455,
      "grad_norm": 0.49188926815986633,
      "learning_rate": 2.8152774381532033e-06,
      "loss": 0.1167,
      "mae_dtheta": 0.03562068194150925,
      "mae_dx": 0.011294915340840816,
      "mae_dy": 0.005306691862642765,
      "pose_mae_dtheta": 0.27664804458618164,
      "pose_mae_dx": 0.08232881128787994,
      "pose_mae_dy": 0.0647086575627327,
      "pose_rmse_dtheta": 0.5031652450561523,
      "pose_rmse_dx": 0.19567269086837769,
      "pose_rmse_dy": 0.15798212587833405,
      "pose_rmse_mean": 0.2856066823005676,
      "rmse_dtheta": 0.054811030626297,
      "rmse_dx": 0.02391611598432064,
      "rmse_dy": 0.01200564019382,
      "rmse_mean": 0.030244264751672745,
      "rotation_flip": 0.013470172882080078,
      "sparse_tokens": 29262.0,
      "step": 7771,
      "turn_loss": 0.29874560236930847,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.3610853001300873,
      "grad_norm": 0.9150153994560242,
      "learning_rate": 2.8140881937046536e-06,
      "loss": 0.2672,
      "mae_dtheta": 0.025182576850056648,
      "mae_dx": 0.011309619061648846,
      "mae_dy": 0.007199300918728113,
      "pose_mae_dtheta": 0.19495560228824615,
      "pose_mae_dx": 0.09547723829746246,
      "pose_mae_dy": 0.05485697463154793,
      "pose_rmse_dtheta": 0.3516160547733307,
      "pose_rmse_dx": 0.20317059755325317,
      "pose_rmse_dy": 0.14275327324867249,
      "pose_rmse_mean": 0.23251330852508545,
      "rmse_dtheta": 0.041837796568870544,
      "rmse_dx": 0.022149205207824707,
      "rmse_dy": 0.017896901816129684,
      "rmse_mean": 0.027294635772705078,
      "rotation_flip": 0.009765625,
      "sparse_tokens": 8939.0,
      "step": 7772,
      "turn_loss": 0.26469385623931885,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.3611317598959301,
      "grad_norm": 0.4138542115688324,
      "learning_rate": 2.8128991021180918e-06,
      "loss": 0.0931,
      "mae_dtheta": 0.03939073905348778,
      "mae_dx": 0.010559220798313618,
      "mae_dy": 0.005266241729259491,
      "pose_mae_dtheta": 0.3409253656864166,
      "pose_mae_dx": 0.10292409360408783,
      "pose_mae_dy": 0.08137747645378113,
      "pose_rmse_dtheta": 0.5433833599090576,
      "pose_rmse_dx": 0.22212590277194977,
      "pose_rmse_dy": 0.1765725165605545,
      "pose_rmse_mean": 0.31402724981307983,
      "rmse_dtheta": 0.05618162825703621,
      "rmse_dx": 0.022360138595104218,
      "rmse_dy": 0.009278036653995514,
      "rmse_mean": 0.029273269698023796,
      "rotation_flip": 0.03132530301809311,
      "sparse_tokens": 6898.0,
      "step": 7773,
      "turn_loss": 0.2926807105541229,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.3611782196617729,
      "grad_norm": 0.5987790822982788,
      "learning_rate": 2.8117101634766676e-06,
      "loss": 0.176,
      "mae_dtheta": 0.03237883746623993,
      "mae_dx": 0.008957174606621265,
      "mae_dy": 0.004217054229229689,
      "pose_mae_dtheta": 0.2496199607849121,
      "pose_mae_dx": 0.08305740356445312,
      "pose_mae_dy": 0.04562581330537796,
      "pose_rmse_dtheta": 0.46009814739227295,
      "pose_rmse_dx": 0.18811021745204926,
      "pose_rmse_dy": 0.11901523917913437,
      "pose_rmse_mean": 0.2557412087917328,
      "rmse_dtheta": 0.05217360705137253,
      "rmse_dx": 0.019933313131332397,
      "rmse_dy": 0.01004852820187807,
      "rmse_mean": 0.027385151013731956,
      "rotation_flip": 0.016242938116192818,
      "sparse_tokens": 24559.0,
      "step": 7774,
      "turn_loss": 0.2305404394865036,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.36122467942761566,
      "grad_norm": 0.4977469742298126,
      "learning_rate": 2.810521377863528e-06,
      "loss": 0.1139,
      "mae_dtheta": 0.056007981300354004,
      "mae_dx": 0.018631331622600555,
      "mae_dy": 0.00413586525246501,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.497747004032135,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.98558044433594,
      "model/head/act_norm_mean": 109.54359130859375,
      "model/head/act_norm_min": 67.99192810058594,
      "model/head/act_over_embed": 75.27938151052547,
      "model/head/grad_frac": 0.10354617983102798,
      "model/head/grad_norm": 0.05153980106115341,
      "model/head/grad_zero_frac": 0.0001573667977936566,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6884765625,
      "model/head/update_ratio": 0.0008783279336057603,
      "model/head/weight_delta": 9.626502990722656,
      "model/head/weight_delta_rel": 0.16887737810611725,
      "model/head/weight_norm": 58.67945098876953,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42222878336906433,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222012866627086,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4221673905849457,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29014067690533507,
      "model/modality_embedder.encoders.pose/grad_frac": 0.14823544025421143,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0737837478518486,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5500710227272727,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0023829585406929255,
      "model/modality_embedder.encoders.pose/weight_delta": 3.082589626312256,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10071781277656555,
      "model/modality_embedder.encoders.pose/weight_norm": 30.963085174560547,
      "model/modality_embedder/grad_frac": 0.14823544025421143,
      "model/modality_embedder/grad_norm": 0.0737837478518486,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5500710227272727,
      "model/modality_embedder/update_ratio": 0.0023829585406929255,
      "model/modality_embedder/weight_delta": 3.082589626312256,
      "model/modality_embedder/weight_delta_rel": 0.10071781277656555,
      "model/modality_embedder/weight_norm": 30.963085174560547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.87158966064453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.672034660218255,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.269780158996582,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.26764383958217,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06275247782468796,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0312348585575819,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011186328483745456,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5670502185821533,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0935448557138443,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.922351837158203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.34295654296875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.497715153769843,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 13.02429485321045,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.835059204893394,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06994886696338654,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.034816838800907135,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011719416361302137,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2565255165100098,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11280859261751175,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.70867919921875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.8641586303711,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.119159226190476,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.27170181274414,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.949330751659428,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0822005420923233,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.040915071964263916,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001333814114332199,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5178635120391846,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11812327057123184,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.675243377685547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.91315460205078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.940435887896825,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.715731620788574,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.20092912464478,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10645576566457748,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05298803746700287,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017720379400998354,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0125174522399902,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10295355319976807,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.902315139770508,
      "model/normalizer/grad_frac": 0.38445577025413513,
      "model/normalizer/grad_norm": 0.1913617104291916,
      "model/normalizer/grad_zero_frac": 0.00016307989426422864,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0024350264575332403,
      "model/normalizer/weight_delta": 6.3610429763793945,
      "model/normalizer/weight_delta_rel": 0.08192654699087143,
      "model/normalizer/weight_norm": 78.58712005615234,
      "pose_mae_dtheta": 0.4040938913822174,
      "pose_mae_dx": 0.13743679225444794,
      "pose_mae_dy": 0.05708007141947746,
      "pose_rmse_dtheta": 0.6894654035568237,
      "pose_rmse_dx": 0.23884567618370056,
      "pose_rmse_dy": 0.12586592137813568,
      "pose_rmse_mean": 0.35139235854148865,
      "rmse_dtheta": 0.07684487849473953,
      "rmse_dx": 0.030559837818145752,
      "rmse_dy": 0.007261789403855801,
      "rmse_mean": 0.03822217136621475,
      "rotation_flip": 0.011695906519889832,
      "sparse_tokens": 2680.0,
      "step": 7775,
      "turn_loss": 0.2462553083896637,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.3612711391934585,
      "grad_norm": 0.6621978878974915,
      "learning_rate": 2.809332745361802e-06,
      "loss": 0.1616,
      "mae_dtheta": 0.030860623344779015,
      "mae_dx": 0.009250889532268047,
      "mae_dy": 0.005512267351150513,
      "pose_mae_dtheta": 0.25753679871559143,
      "pose_mae_dx": 0.06554869562387466,
      "pose_mae_dy": 0.06013587489724159,
      "pose_rmse_dtheta": 0.4970761239528656,
      "pose_rmse_dx": 0.1688808649778366,
      "pose_rmse_dy": 0.15063726902008057,
      "pose_rmse_mean": 0.2721980810165405,
      "rmse_dtheta": 0.051746681332588196,
      "rmse_dx": 0.02074762061238289,
      "rmse_dy": 0.013067001476883888,
      "rmse_mean": 0.028520433232188225,
      "rotation_flip": 0.010398613288998604,
      "sparse_tokens": 8911.0,
      "step": 7776,
      "turn_loss": 0.26848363876342773,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.36131759895930127,
      "grad_norm": 0.6750862002372742,
      "learning_rate": 2.8081442660546126e-06,
      "loss": 0.1802,
      "mae_dtheta": 0.039496734738349915,
      "mae_dx": 0.015006116591393948,
      "mae_dy": 0.008328800089657307,
      "pose_mae_dtheta": 0.2935965061187744,
      "pose_mae_dx": 0.13954269886016846,
      "pose_mae_dy": 0.06682807952165604,
      "pose_rmse_dtheta": 0.4923943877220154,
      "pose_rmse_dx": 0.26549389958381653,
      "pose_rmse_dy": 0.12691976130008698,
      "pose_rmse_mean": 0.29493603110313416,
      "rmse_dtheta": 0.057445086538791656,
      "rmse_dx": 0.02580924518406391,
      "rmse_dy": 0.016934262588620186,
      "rmse_mean": 0.033396199345588684,
      "rotation_flip": 0.008333333767950535,
      "sparse_tokens": 6801.0,
      "step": 7777,
      "turn_loss": 0.3856118619441986,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.36136405872514404,
      "grad_norm": 0.6370770931243896,
      "learning_rate": 2.8069559400250733e-06,
      "loss": 0.1899,
      "mae_dtheta": 0.009408209472894669,
      "mae_dx": 0.0015562057960778475,
      "mae_dy": 0.002203024923801422,
      "pose_mae_dtheta": 0.0693473070859909,
      "pose_mae_dx": 0.016328515484929085,
      "pose_mae_dy": 0.023334357887506485,
      "pose_rmse_dtheta": 0.2108006775379181,
      "pose_rmse_dx": 0.0497431643307209,
      "pose_rmse_dy": 0.06743331253528595,
      "pose_rmse_mean": 0.10932572931051254,
      "rmse_dtheta": 0.024391992017626762,
      "rmse_dx": 0.004828440025448799,
      "rmse_dy": 0.006394210737198591,
      "rmse_mean": 0.011871548369526863,
      "rotation_flip": 0.002624671906232834,
      "sparse_tokens": 32073.0,
      "step": 7778,
      "turn_loss": 0.07625596225261688,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.3614105184909868,
      "grad_norm": 0.49740710854530334,
      "learning_rate": 2.80576776735628e-06,
      "loss": 0.0905,
      "mae_dtheta": 0.03461141511797905,
      "mae_dx": 0.010422796942293644,
      "mae_dy": 0.005422500427812338,
      "pose_mae_dtheta": 0.290849894285202,
      "pose_mae_dx": 0.0858207568526268,
      "pose_mae_dy": 0.05495984107255936,
      "pose_rmse_dtheta": 0.4860295057296753,
      "pose_rmse_dx": 0.20969323813915253,
      "pose_rmse_dy": 0.17689307034015656,
      "pose_rmse_mean": 0.2908719480037689,
      "rmse_dtheta": 0.05431373417377472,
      "rmse_dx": 0.02259821444749832,
      "rmse_dy": 0.01530290674418211,
      "rmse_mean": 0.030738284811377525,
      "rotation_flip": 0.022364217787981033,
      "sparse_tokens": 9526.0,
      "step": 7779,
      "turn_loss": 0.27449607849121094,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3614569782568296,
      "grad_norm": 0.6660910248756409,
      "learning_rate": 2.8045797481313266e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.00906037725508213,
      "mae_dx": 0.0022988906130194664,
      "mae_dy": 0.0017263933550566435,
      "pose_mae_dtheta": 0.06025534123182297,
      "pose_mae_dx": 0.021167607977986336,
      "pose_mae_dy": 0.016525477170944214,
      "pose_rmse_dtheta": 0.1726195216178894,
      "pose_rmse_dx": 0.06330986320972443,
      "pose_rmse_dy": 0.03698844462633133,
      "pose_rmse_mean": 0.09097261726856232,
      "rmse_dtheta": 0.02256573736667633,
      "rmse_dx": 0.007399337366223335,
      "rmse_dy": 0.004065455868840218,
      "rmse_mean": 0.011343510821461678,
      "rotation_flip": 0.006849315017461777,
      "sparse_tokens": 32089.0,
      "step": 7780,
      "turn_loss": 0.07352928072214127,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3615034380226724,
      "grad_norm": 0.486590713262558,
      "learning_rate": 2.803391882433288e-06,
      "loss": 0.0777,
      "mae_dtheta": 0.008065994828939438,
      "mae_dx": 0.001590623171068728,
      "mae_dy": 0.0016905205557122827,
      "pose_mae_dtheta": 0.05608315020799637,
      "pose_mae_dx": 0.012499361298978329,
      "pose_mae_dy": 0.018147805705666542,
      "pose_rmse_dtheta": 0.2326926589012146,
      "pose_rmse_dx": 0.04085036367177963,
      "pose_rmse_dy": 0.09640845656394958,
      "pose_rmse_mean": 0.1233171671628952,
      "rmse_dtheta": 0.027210844680666924,
      "rmse_dx": 0.005921344738453627,
      "rmse_dy": 0.009051484987139702,
      "rmse_mean": 0.014061225578188896,
      "rotation_flip": 0.0019083969527855515,
      "sparse_tokens": 32121.0,
      "step": 7781,
      "turn_loss": 0.06319479644298553,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.36154989778851515,
      "grad_norm": 0.4691310524940491,
      "learning_rate": 2.8022041703452334e-06,
      "loss": 0.1363,
      "mae_dtheta": 0.010728741064667702,
      "mae_dx": 0.0014846277190372348,
      "mae_dy": 0.002329412614926696,
      "pose_mae_dtheta": 0.07377587258815765,
      "pose_mae_dx": 0.02207517996430397,
      "pose_mae_dy": 0.030005263164639473,
      "pose_rmse_dtheta": 0.18017488718032837,
      "pose_rmse_dx": 0.06213030219078064,
      "pose_rmse_dy": 0.08015577495098114,
      "pose_rmse_mean": 0.10748698562383652,
      "rmse_dtheta": 0.022860094904899597,
      "rmse_dx": 0.003967536147683859,
      "rmse_dy": 0.005134758539497852,
      "rmse_mean": 0.010654130950570107,
      "rotation_flip": 0.0057212915271520615,
      "sparse_tokens": 32105.0,
      "step": 7782,
      "turn_loss": 0.08048257976770401,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.36159635755435793,
      "grad_norm": 0.47239264845848083,
      "learning_rate": 2.8010166119502238e-06,
      "loss": 0.0867,
      "mae_dtheta": 0.009344794787466526,
      "mae_dx": 0.001994781196117401,
      "mae_dy": 0.0027709901332855225,
      "pose_mae_dtheta": 0.06948689371347427,
      "pose_mae_dx": 0.026977861300110817,
      "pose_mae_dy": 0.03066032938659191,
      "pose_rmse_dtheta": 0.16585063934326172,
      "pose_rmse_dx": 0.07824408262968063,
      "pose_rmse_dy": 0.07605799287557602,
      "pose_rmse_mean": 0.10671757906675339,
      "rmse_dtheta": 0.020305000245571136,
      "rmse_dx": 0.006120668258517981,
      "rmse_dy": 0.007052916567772627,
      "rmse_mean": 0.01115952804684639,
      "rotation_flip": 0.002037697471678257,
      "sparse_tokens": 32041.0,
      "step": 7783,
      "turn_loss": 0.08277899026870728,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3616428173202007,
      "grad_norm": 0.3674556612968445,
      "learning_rate": 2.7998292073313e-06,
      "loss": 0.101,
      "mae_dtheta": 0.006410249508917332,
      "mae_dx": 0.001606422825716436,
      "mae_dy": 0.0013865146320313215,
      "pose_mae_dtheta": 0.04813801869750023,
      "pose_mae_dx": 0.01583399623632431,
      "pose_mae_dy": 0.012602437287569046,
      "pose_rmse_dtheta": 0.17898038029670715,
      "pose_rmse_dx": 0.049012742936611176,
      "pose_rmse_dy": 0.036798566579818726,
      "pose_rmse_mean": 0.08826389908790588,
      "rmse_dtheta": 0.019204340875148773,
      "rmse_dx": 0.005134936422109604,
      "rmse_dy": 0.004231933504343033,
      "rmse_mean": 0.009523737244307995,
      "rotation_flip": 0.0069777583703398705,
      "sparse_tokens": 32153.0,
      "step": 7784,
      "turn_loss": 0.06286609172821045,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.3616892770860435,
      "grad_norm": 0.5524497628211975,
      "learning_rate": 2.798641956571503e-06,
      "loss": 0.1285,
      "mae_dtheta": 0.030980980023741722,
      "mae_dx": 0.013028278946876526,
      "mae_dy": 0.006009885109961033,
      "pose_mae_dtheta": 0.22248230874538422,
      "pose_mae_dx": 0.11054392158985138,
      "pose_mae_dy": 0.061667658388614655,
      "pose_rmse_dtheta": 0.41767844557762146,
      "pose_rmse_dx": 0.23587073385715485,
      "pose_rmse_dy": 0.14514197409152985,
      "pose_rmse_mean": 0.26623040437698364,
      "rmse_dtheta": 0.04828915745019913,
      "rmse_dx": 0.025320136919617653,
      "rmse_dy": 0.013614967465400696,
      "rmse_mean": 0.02907475456595421,
      "rotation_flip": 0.020408162847161293,
      "sparse_tokens": 19092.0,
      "step": 7785,
      "turn_loss": 0.28698045015335083,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 27817.0,
      "epoch": 0.36173573685188626,
      "grad_norm": 0.26711738109588623,
      "learning_rate": 2.797454859753853e-06,
      "loss": 0.0926,
      "mae_dtheta": 0.037636201828718185,
      "mae_dx": 0.010931131429970264,
      "mae_dy": 0.004486643243581057,
      "pose_mae_dtheta": 0.3028757870197296,
      "pose_mae_dx": 0.0867772027850151,
      "pose_mae_dy": 0.055553410202264786,
      "pose_rmse_dtheta": 0.48708340525627136,
      "pose_rmse_dx": 0.1948656141757965,
      "pose_rmse_dy": 0.14280474185943604,
      "pose_rmse_mean": 0.27491793036460876,
      "rmse_dtheta": 0.05493627488613129,
      "rmse_dx": 0.02240200713276863,
      "rmse_dy": 0.009117485024034977,
      "rmse_mean": 0.028818588703870773,
      "rotation_flip": 0.011848341673612595,
      "sparse_tokens": 21897.0,
      "step": 7786,
      "turn_loss": 0.2633027136325836,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.36178219661772903,
      "grad_norm": 0.4398122727870941,
      "learning_rate": 2.796267916961369e-06,
      "loss": 0.1281,
      "mae_dtheta": 0.03166884183883667,
      "mae_dx": 0.014638666063547134,
      "mae_dy": 0.00736716715618968,
      "pose_mae_dtheta": 0.2663334310054779,
      "pose_mae_dx": 0.12254776060581207,
      "pose_mae_dy": 0.07692662626504898,
      "pose_rmse_dtheta": 0.47705408930778503,
      "pose_rmse_dx": 0.26334336400032043,
      "pose_rmse_dy": 0.1816059648990631,
      "pose_rmse_mean": 0.3073344826698303,
      "rmse_dtheta": 0.05078962817788124,
      "rmse_dx": 0.027427593246102333,
      "rmse_dy": 0.01603509858250618,
      "rmse_mean": 0.03141744062304497,
      "rotation_flip": 0.008976660668849945,
      "sparse_tokens": 10586.0,
      "step": 7787,
      "turn_loss": 0.3154108226299286,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.3618286563835718,
      "grad_norm": 0.677794873714447,
      "learning_rate": 2.795081128277051e-06,
      "loss": 0.2504,
      "mae_dtheta": 0.0337640680372715,
      "mae_dx": 0.013800776563584805,
      "mae_dy": 0.00783782172948122,
      "pose_mae_dtheta": 0.2082357257604599,
      "pose_mae_dx": 0.11139777302742004,
      "pose_mae_dy": 0.0935778096318245,
      "pose_rmse_dtheta": 0.34374183416366577,
      "pose_rmse_dx": 0.23763197660446167,
      "pose_rmse_dy": 0.17379407584667206,
      "pose_rmse_mean": 0.25172263383865356,
      "rmse_dtheta": 0.04922289028763771,
      "rmse_dx": 0.02814738266170025,
      "rmse_dy": 0.011923828162252903,
      "rmse_mean": 0.029764700680971146,
      "rotation_flip": 0.012718601152300835,
      "sparse_tokens": 10676.0,
      "step": 7788,
      "turn_loss": 0.28966131806373596,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3618751161494146,
      "grad_norm": 0.40008798241615295,
      "learning_rate": 2.7938944937838924e-06,
      "loss": 0.086,
      "mae_dtheta": 0.009718436747789383,
      "mae_dx": 0.0017073570052161813,
      "mae_dy": 0.0017718099988996983,
      "pose_mae_dtheta": 0.07024647295475006,
      "pose_mae_dx": 0.017447173595428467,
      "pose_mae_dy": 0.023930633440613747,
      "pose_rmse_dtheta": 0.1914912760257721,
      "pose_rmse_dx": 0.04891594871878624,
      "pose_rmse_dy": 0.049565739929676056,
      "pose_rmse_mean": 0.0966576561331749,
      "rmse_dtheta": 0.023215875029563904,
      "rmse_dx": 0.006241785828024149,
      "rmse_dy": 0.00424488540738821,
      "rmse_mean": 0.011234181933104992,
      "rotation_flip": 0.0031250000465661287,
      "sparse_tokens": 32073.0,
      "step": 7789,
      "turn_loss": 0.07472436130046844,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25233.0,
      "epoch": 0.36192157591525737,
      "grad_norm": 0.7319760918617249,
      "learning_rate": 2.7927080135648788e-06,
      "loss": 0.1486,
      "mae_dtheta": 0.03852198272943497,
      "mae_dx": 0.013920048251748085,
      "mae_dy": 0.00663010636344552,
      "pose_mae_dtheta": 0.30645951628685,
      "pose_mae_dx": 0.10727792978286743,
      "pose_mae_dy": 0.06032856926321983,
      "pose_rmse_dtheta": 0.5278008580207825,
      "pose_rmse_dx": 0.23028326034545898,
      "pose_rmse_dy": 0.13673685491085052,
      "pose_rmse_mean": 0.2982736825942993,
      "rmse_dtheta": 0.056869447231292725,
      "rmse_dx": 0.026012543588876724,
      "rmse_dy": 0.013601313345134258,
      "rmse_mean": 0.03216110169887543,
      "rotation_flip": 0.02617398090660572,
      "sparse_tokens": 20823.0,
      "step": 7790,
      "turn_loss": 0.27209359407424927,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.36196803568110014,
      "grad_norm": 0.46673956513404846,
      "learning_rate": 2.7915216877029754e-06,
      "loss": 0.129,
      "mae_dtheta": 0.014611353166401386,
      "mae_dx": 0.0023386904504150152,
      "mae_dy": 0.0038411440327763557,
      "pose_mae_dtheta": 0.09515707939863205,
      "pose_mae_dx": 0.03383513540029526,
      "pose_mae_dy": 0.04064488410949707,
      "pose_rmse_dtheta": 0.20372554659843445,
      "pose_rmse_dx": 0.08384565263986588,
      "pose_rmse_dy": 0.0894913449883461,
      "pose_rmse_mean": 0.12568750977516174,
      "rmse_dtheta": 0.026870224624872208,
      "rmse_dx": 0.0068101123906672,
      "rmse_dy": 0.00760303670540452,
      "rmse_mean": 0.01376112550497055,
      "rotation_flip": 0.009475464932620525,
      "sparse_tokens": 32089.0,
      "step": 7791,
      "turn_loss": 0.1428920030593872,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.362014495446943,
      "grad_norm": 0.487541526556015,
      "learning_rate": 2.7903355162811483e-06,
      "loss": 0.0669,
      "mae_dtheta": 0.035077791661024094,
      "mae_dx": 0.013581492006778717,
      "mae_dy": 0.005773168057203293,
      "pose_mae_dtheta": 0.3178486227989197,
      "pose_mae_dx": 0.09255979210138321,
      "pose_mae_dy": 0.08438213169574738,
      "pose_rmse_dtheta": 0.4858589470386505,
      "pose_rmse_dx": 0.22457431256771088,
      "pose_rmse_dy": 0.1655663400888443,
      "pose_rmse_mean": 0.291999876499176,
      "rmse_dtheta": 0.04902813583612442,
      "rmse_dx": 0.025566693395376205,
      "rmse_dy": 0.00998110044747591,
      "rmse_mean": 0.028191976249217987,
      "rotation_flip": 0.02153846062719822,
      "sparse_tokens": 5944.0,
      "step": 7792,
      "turn_loss": 0.35380518436431885,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.36206095521278575,
      "grad_norm": 0.7097533941268921,
      "learning_rate": 2.789149499382345e-06,
      "loss": 0.2667,
      "mae_dtheta": 0.029957737773656845,
      "mae_dx": 0.004924061242491007,
      "mae_dy": 0.006057011429220438,
      "pose_mae_dtheta": 0.2114741951227188,
      "pose_mae_dx": 0.056151315569877625,
      "pose_mae_dy": 0.09932497143745422,
      "pose_rmse_dtheta": 0.3969408869743347,
      "pose_rmse_dx": 0.11019942909479141,
      "pose_rmse_dy": 0.1802663505077362,
      "pose_rmse_mean": 0.22913555800914764,
      "rmse_dtheta": 0.04597741365432739,
      "rmse_dx": 0.012238898314535618,
      "rmse_dy": 0.010080893523991108,
      "rmse_mean": 0.022765737026929855,
      "rotation_flip": 0.009242144413292408,
      "sparse_tokens": 9344.0,
      "step": 7793,
      "turn_loss": 0.23118093609809875,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.36210741497862853,
      "grad_norm": 0.5087683200836182,
      "learning_rate": 2.7879636370895013e-06,
      "loss": 0.1377,
      "mae_dtheta": 0.029713699594140053,
      "mae_dx": 0.010556505061686039,
      "mae_dy": 0.005720432382076979,
      "pose_mae_dtheta": 0.21973177790641785,
      "pose_mae_dx": 0.062043868005275726,
      "pose_mae_dy": 0.0817115530371666,
      "pose_rmse_dtheta": 0.3972415030002594,
      "pose_rmse_dx": 0.1446133702993393,
      "pose_rmse_dy": 0.18498386442661285,
      "pose_rmse_mean": 0.24227957427501678,
      "rmse_dtheta": 0.04670614004135132,
      "rmse_dx": 0.02297949232161045,
      "rmse_dy": 0.010219721123576164,
      "rmse_mean": 0.026635117828845978,
      "rotation_flip": 0.010695187374949455,
      "sparse_tokens": 3137.0,
      "step": 7794,
      "turn_loss": 0.2605491876602173,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.3621538747444713,
      "grad_norm": 0.540254533290863,
      "learning_rate": 2.7867779294855502e-06,
      "loss": 0.1783,
      "mae_dtheta": 0.03298326954245567,
      "mae_dx": 0.013688946142792702,
      "mae_dy": 0.006683152634650469,
      "pose_mae_dtheta": 0.25720909237861633,
      "pose_mae_dx": 0.10249114781618118,
      "pose_mae_dy": 0.06925913691520691,
      "pose_rmse_dtheta": 0.4668137729167938,
      "pose_rmse_dx": 0.22285133600234985,
      "pose_rmse_dy": 0.16142533719539642,
      "pose_rmse_mean": 0.28369683027267456,
      "rmse_dtheta": 0.05203406885266304,
      "rmse_dx": 0.026855794712901115,
      "rmse_dy": 0.012941350229084492,
      "rmse_mean": 0.030610404908657074,
      "rotation_flip": 0.0148731404915452,
      "sparse_tokens": 20337.0,
      "step": 7795,
      "turn_loss": 0.27243146300315857,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.3622003345103141,
      "grad_norm": 0.5727373957633972,
      "learning_rate": 2.7855923766534037e-06,
      "loss": 0.0957,
      "mae_dtheta": 0.0280879195779562,
      "mae_dx": 0.005872491281479597,
      "mae_dy": 0.002642951672896743,
      "pose_mae_dtheta": 0.23650245368480682,
      "pose_mae_dx": 0.0518081933259964,
      "pose_mae_dy": 0.034076303243637085,
      "pose_rmse_dtheta": 0.5020672082901001,
      "pose_rmse_dx": 0.1400344967842102,
      "pose_rmse_dy": 0.08562567085027695,
      "pose_rmse_mean": 0.24257579445838928,
      "rmse_dtheta": 0.051140595227479935,
      "rmse_dx": 0.01583069935441017,
      "rmse_dy": 0.005263577681034803,
      "rmse_mean": 0.024078290909528732,
      "rotation_flip": 0.014639639295637608,
      "sparse_tokens": 20847.0,
      "step": 7796,
      "turn_loss": 0.15255695581436157,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.36224679427615686,
      "grad_norm": 0.38835248351097107,
      "learning_rate": 2.784406978675973e-06,
      "loss": 0.132,
      "mae_dtheta": 0.04053015261888504,
      "mae_dx": 0.012115075252950191,
      "mae_dy": 0.005068829283118248,
      "pose_mae_dtheta": 0.3360445499420166,
      "pose_mae_dx": 0.10024205595254898,
      "pose_mae_dy": 0.0559028759598732,
      "pose_rmse_dtheta": 0.5596113204956055,
      "pose_rmse_dx": 0.20489424467086792,
      "pose_rmse_dy": 0.14098142087459564,
      "pose_rmse_mean": 0.3018290102481842,
      "rmse_dtheta": 0.058588553220033646,
      "rmse_dx": 0.024100687354803085,
      "rmse_dy": 0.01031353510916233,
      "rmse_mean": 0.031000925227999687,
      "rotation_flip": 0.008138352073729038,
      "sparse_tokens": 15606.0,
      "step": 7797,
      "turn_loss": 0.29501426219940186,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 36226.0,
      "epoch": 0.36229325404199964,
      "grad_norm": 0.5937511324882507,
      "learning_rate": 2.78322173563615e-06,
      "loss": 0.1874,
      "mae_dtheta": 0.041988980025053024,
      "mae_dx": 0.017382552847266197,
      "mae_dy": 0.007418938912451267,
      "pose_mae_dtheta": 0.3514743745326996,
      "pose_mae_dx": 0.14806386828422546,
      "pose_mae_dy": 0.08935915678739548,
      "pose_rmse_dtheta": 0.57909095287323,
      "pose_rmse_dx": 0.2840021252632141,
      "pose_rmse_dy": 0.1809614598751068,
      "pose_rmse_mean": 0.34801816940307617,
      "rmse_dtheta": 0.05940616503357887,
      "rmse_dx": 0.03069275990128517,
      "rmse_dy": 0.013574576936662197,
      "rmse_mean": 0.03455783426761627,
      "rotation_flip": 0.014218009077012539,
      "sparse_tokens": 29059.0,
      "step": 7798,
      "turn_loss": 0.37374147772789,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3623397138078424,
      "grad_norm": 0.6221397519111633,
      "learning_rate": 2.7820366476168224e-06,
      "loss": 0.2514,
      "mae_dtheta": 0.01181603129953146,
      "mae_dx": 0.0015672608278691769,
      "mae_dy": 0.0030380738899111748,
      "pose_mae_dtheta": 0.08111747354269028,
      "pose_mae_dx": 0.024866817519068718,
      "pose_mae_dy": 0.03373676538467407,
      "pose_rmse_dtheta": 0.20104511082172394,
      "pose_rmse_dx": 0.062153179198503494,
      "pose_rmse_dy": 0.07234662026166916,
      "pose_rmse_mean": 0.11184830963611603,
      "rmse_dtheta": 0.024073230102658272,
      "rmse_dx": 0.004398738965392113,
      "rmse_dy": 0.006058079656213522,
      "rmse_mean": 0.011510016396641731,
      "rotation_flip": 0.004018998704850674,
      "sparse_tokens": 32041.0,
      "step": 7799,
      "turn_loss": 0.10283108055591583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 38494.0,
      "epoch": 0.3623861735736852,
      "grad_norm": 0.5152296423912048,
      "learning_rate": 2.7808517147008608e-06,
      "loss": 0.1901,
      "mae_dtheta": 0.0329849049448967,
      "mae_dx": 0.009856517426669598,
      "mae_dy": 0.0044206553138792515,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5152297019958496,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.41639709472656,
      "model/head/act_norm_mean": 109.71072413340336,
      "model/head/act_norm_min": 71.27289581298828,
      "model/head/act_over_embed": 75.39423675245679,
      "model/head/grad_frac": 0.12306400388479233,
      "model/head/grad_norm": 0.06340622901916504,
      "model/head/grad_zero_frac": 0.00017862400272861123,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6940979516806722,
      "model/head/update_ratio": 0.0010805338388308883,
      "model/head/weight_delta": 9.632678031921387,
      "model/head/weight_delta_rel": 0.16898570954799652,
      "model/head/weight_norm": 58.68046569824219,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4222344756126404,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222344756126404,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4222344756126404,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.290163484662448,
      "model/modality_embedder.encoders.pose/grad_frac": 0.03637786954641342,
      "model/modality_embedder.encoders.pose/grad_norm": 0.018742958083748817,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0006053269607946277,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0804989337921143,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10064949840307236,
      "model/modality_embedder.encoders.pose/weight_norm": 30.963361740112305,
      "model/modality_embedder/grad_frac": 0.03637786954641342,
      "model/modality_embedder/grad_norm": 0.018742958083748817,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0006053269607946277,
      "model/modality_embedder/weight_delta": 3.0804989337921143,
      "model/modality_embedder/weight_delta_rel": 0.10064949840307236,
      "model/modality_embedder/weight_norm": 30.963361740112305,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.15760803222656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.561951864078964,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.159106254577637,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.191993911463875,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0989365503191948,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.050975050777196884,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018255624454468489,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5699496269226074,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09365051239728928,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.922929763793945,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.41783142089844,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.356788548752835,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.255729675292969,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.738213122550043,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10054799914360046,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.051805317401885986,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017437292262911797,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.26033091545105,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11294040828943253,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.709495544433594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.9212646484375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.944800837001466,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.729619979858398,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.82951003423978,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11785757541656494,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.060723721981048584,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001979490742087364,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5220656394958496,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11826436966657639,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.676435470581055,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.39977264404297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.784149076297187,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.101192474365234,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.093527364533326,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.12679877877235413,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06533049792051315,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0021847402676939964,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0159263610839844,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10307005047798157,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.90309715270996,
      "model/normalizer/grad_frac": 0.4994652569293976,
      "model/normalizer/grad_norm": 0.25733932852745056,
      "model/normalizer/grad_zero_frac": 0.00019144162070006132,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0032745255157351494,
      "model/normalizer/weight_delta": 6.368454456329346,
      "model/normalizer/weight_delta_rel": 0.08202200382947922,
      "model/normalizer/weight_norm": 78.5882797241211,
      "pose_mae_dtheta": 0.2518939673900604,
      "pose_mae_dx": 0.06968973577022552,
      "pose_mae_dy": 0.05293653532862663,
      "pose_rmse_dtheta": 0.45650699734687805,
      "pose_rmse_dx": 0.16000503301620483,
      "pose_rmse_dy": 0.11766234785318375,
      "pose_rmse_mean": 0.2447248101234436,
      "rmse_dtheta": 0.05135741084814072,
      "rmse_dx": 0.021179072558879852,
      "rmse_dy": 0.009262667037546635,
      "rmse_mean": 0.027266383171081543,
      "rotation_flip": 0.009345794096589088,
      "sparse_tokens": 29794.0,
      "step": 7800,
      "turn_loss": 0.25257691740989685,
      "turns": 119.0,
      "turns_per_sample": 119.0
    },
    {
      "epoch": 0.3623861735736852,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30671560764312744,
      "eval_objectnav_nopose_mae_dtheta": 0.040117617696523666,
      "eval_objectnav_nopose_mae_dx": 0.012946955859661102,
      "eval_objectnav_nopose_mae_dy": 0.004996716044843197,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32291626930236816,
      "eval_objectnav_nopose_pose_mae_dx": 0.10336551815271378,
      "eval_objectnav_nopose_pose_mae_dy": 0.05534450337290764,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5443847179412842,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2302185744047165,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13208264112472534,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3022286593914032,
      "eval_objectnav_nopose_rmse_dtheta": 0.05802050232887268,
      "eval_objectnav_nopose_rmse_dx": 0.025659410282969475,
      "eval_objectnav_nopose_rmse_dy": 0.010302566923201084,
      "eval_objectnav_nopose_rmse_mean": 0.031327493488788605,
      "eval_objectnav_nopose_rotation_flip": 0.017165038734674454,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30671560764312744,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 7800
    },
    {
      "epoch": 0.3623861735736852,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27764809131622314,
      "eval_objectnav_pose_mae_dtheta": 0.03537629917263985,
      "eval_objectnav_pose_mae_dx": 0.011624864302575588,
      "eval_objectnav_pose_mae_dy": 0.004834791179746389,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2670167088508606,
      "eval_objectnav_pose_pose_mae_dx": 0.0911485031247139,
      "eval_objectnav_pose_pose_mae_dy": 0.05062638968229294,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4655725359916687,
      "eval_objectnav_pose_pose_rmse_dx": 0.2090507596731186,
      "eval_objectnav_pose_pose_rmse_dy": 0.12394040077924728,
      "eval_objectnav_pose_pose_rmse_mean": 0.2661879062652588,
      "eval_objectnav_pose_rmse_dtheta": 0.052942220121622086,
      "eval_objectnav_pose_rmse_dx": 0.02393021062016487,
      "eval_objectnav_pose_rmse_dy": 0.010264153592288494,
      "eval_objectnav_pose_rmse_mean": 0.029045527800917625,
      "eval_objectnav_pose_rotation_flip": 0.017124682664871216,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27764809131622314,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 7800
    },
    {
      "epoch": 0.3623861735736852,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.0901685580611229,
      "eval_pointnav_mae_dtheta": 0.010357567109167576,
      "eval_pointnav_mae_dx": 0.002334439195692539,
      "eval_pointnav_mae_dy": 0.002397396368905902,
      "eval_pointnav_pose_mae_dtheta": 0.07094240933656693,
      "eval_pointnav_pose_mae_dx": 0.0257280133664608,
      "eval_pointnav_pose_mae_dy": 0.026014111936092377,
      "eval_pointnav_pose_rmse_dtheta": 0.2048528492450714,
      "eval_pointnav_pose_rmse_dx": 0.07803663611412048,
      "eval_pointnav_pose_rmse_dy": 0.07633308321237564,
      "eval_pointnav_pose_rmse_mean": 0.11974085867404938,
      "eval_pointnav_rmse_dtheta": 0.025507796555757523,
      "eval_pointnav_rmse_dx": 0.0074534108862280846,
      "eval_pointnav_rmse_dy": 0.006490034982562065,
      "eval_pointnav_rmse_mean": 0.013150414451956749,
      "eval_pointnav_rotation_flip": 0.005658339709043503,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.0901685580611229,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 7800
    },
    {
      "epoch": 0.3623861735736852,
      "eval_loss": 0.22484408567349115,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30671560764312744,
      "eval_objectnav_nopose_mae_dtheta": 0.040117617696523666,
      "eval_objectnav_nopose_mae_dx": 0.012946955859661102,
      "eval_objectnav_nopose_mae_dy": 0.004996716044843197,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32291626930236816,
      "eval_objectnav_nopose_pose_mae_dx": 0.10336551815271378,
      "eval_objectnav_nopose_pose_mae_dy": 0.05534450337290764,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5443847179412842,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2302185744047165,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13208264112472534,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3022286593914032,
      "eval_objectnav_nopose_rmse_dtheta": 0.05802050232887268,
      "eval_objectnav_nopose_rmse_dx": 0.025659410282969475,
      "eval_objectnav_nopose_rmse_dy": 0.010302566923201084,
      "eval_objectnav_nopose_rmse_mean": 0.031327493488788605,
      "eval_objectnav_nopose_rotation_flip": 0.017165038734674454,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30671560764312744,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27764809131622314,
      "eval_objectnav_pose_mae_dtheta": 0.03537629917263985,
      "eval_objectnav_pose_mae_dx": 0.011624864302575588,
      "eval_objectnav_pose_mae_dy": 0.004834791179746389,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2670167088508606,
      "eval_objectnav_pose_pose_mae_dx": 0.0911485031247139,
      "eval_objectnav_pose_pose_mae_dy": 0.05062638968229294,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4655725359916687,
      "eval_objectnav_pose_pose_rmse_dx": 0.2090507596731186,
      "eval_objectnav_pose_pose_rmse_dy": 0.12394040077924728,
      "eval_objectnav_pose_pose_rmse_mean": 0.2661879062652588,
      "eval_objectnav_pose_rmse_dtheta": 0.052942220121622086,
      "eval_objectnav_pose_rmse_dx": 0.02393021062016487,
      "eval_objectnav_pose_rmse_dy": 0.010264153592288494,
      "eval_objectnav_pose_rmse_mean": 0.029045527800917625,
      "eval_objectnav_pose_rotation_flip": 0.017124682664871216,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27764809131622314,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.0901685580611229,
      "eval_pointnav_mae_dtheta": 0.010357567109167576,
      "eval_pointnav_mae_dx": 0.002334439195692539,
      "eval_pointnav_mae_dy": 0.002397396368905902,
      "eval_pointnav_pose_mae_dtheta": 0.07094240933656693,
      "eval_pointnav_pose_mae_dx": 0.0257280133664608,
      "eval_pointnav_pose_mae_dy": 0.026014111936092377,
      "eval_pointnav_pose_rmse_dtheta": 0.2048528492450714,
      "eval_pointnav_pose_rmse_dx": 0.07803663611412048,
      "eval_pointnav_pose_rmse_dy": 0.07633308321237564,
      "eval_pointnav_pose_rmse_mean": 0.11974085867404938,
      "eval_pointnav_rmse_dtheta": 0.025507796555757523,
      "eval_pointnav_rmse_dx": 0.0074534108862280846,
      "eval_pointnav_rmse_dy": 0.006490034982562065,
      "eval_pointnav_rmse_mean": 0.013150414451956749,
      "eval_pointnav_rotation_flip": 0.005658339709043503,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.0901685580611229,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 7800
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.36243263333952797,
      "grad_norm": 0.40522125363349915,
      "learning_rate": 2.7796669369711294e-06,
      "loss": 0.0708,
      "mae_dtheta": 0.00870665255934,
      "mae_dx": 0.0026533580385148525,
      "mae_dy": 0.003113360144197941,
      "pose_mae_dtheta": 0.05580537021160126,
      "pose_mae_dx": 0.02934160828590393,
      "pose_mae_dy": 0.023471195250749588,
      "pose_rmse_dtheta": 0.12967762351036072,
      "pose_rmse_dx": 0.08450529724359512,
      "pose_rmse_dy": 0.05825979262590408,
      "pose_rmse_mean": 0.09081423282623291,
      "rmse_dtheta": 0.01927170902490616,
      "rmse_dx": 0.0077097974717617035,
      "rmse_dy": 0.007371989078819752,
      "rmse_mean": 0.011451165191829205,
      "rotation_flip": 0.006430868059396744,
      "sparse_tokens": 32121.0,
      "step": 7801,
      "turn_loss": 0.07305020093917847,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.36247909310537074,
      "grad_norm": 0.5219833254814148,
      "learning_rate": 2.778482314510483e-06,
      "loss": 0.0969,
      "mae_dtheta": 0.0062329936772584915,
      "mae_dx": 0.0015856234822422266,
      "mae_dy": 0.0013419240713119507,
      "pose_mae_dtheta": 0.04104489088058472,
      "pose_mae_dx": 0.014818570576608181,
      "pose_mae_dy": 0.017247091978788376,
      "pose_rmse_dtheta": 0.0996374636888504,
      "pose_rmse_dx": 0.03644238039851189,
      "pose_rmse_dy": 0.04084329679608345,
      "pose_rmse_mean": 0.058974381536245346,
      "rmse_dtheta": 0.015458919107913971,
      "rmse_dx": 0.004828727338463068,
      "rmse_dy": 0.0030611485708504915,
      "rmse_mean": 0.0077829319052398205,
      "rotation_flip": 0.0016842104960232973,
      "sparse_tokens": 32137.0,
      "step": 7802,
      "turn_loss": 0.061844903975725174,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3625255528712135,
      "grad_norm": 0.5806219577789307,
      "learning_rate": 2.777297847401759e-06,
      "loss": 0.145,
      "mae_dtheta": 0.010151529684662819,
      "mae_dx": 0.0015026830369606614,
      "mae_dy": 0.0025568283163011074,
      "pose_mae_dtheta": 0.06602398306131363,
      "pose_mae_dx": 0.02370622754096985,
      "pose_mae_dy": 0.030199604108929634,
      "pose_rmse_dtheta": 0.1536068320274353,
      "pose_rmse_dx": 0.05689491704106331,
      "pose_rmse_dy": 0.06436335295438766,
      "pose_rmse_mean": 0.09162169694900513,
      "rmse_dtheta": 0.02093149907886982,
      "rmse_dx": 0.004480794072151184,
      "rmse_dy": 0.004811904393136501,
      "rmse_mean": 0.010074732825160027,
      "rotation_flip": 0.004256828688085079,
      "sparse_tokens": 32057.0,
      "step": 7803,
      "turn_loss": 0.07817716896533966,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3625720126370563,
      "grad_norm": 0.33636119961738586,
      "learning_rate": 2.776113535727791e-06,
      "loss": 0.0781,
      "mae_dtheta": 0.007657312788069248,
      "mae_dx": 0.0007593147456645966,
      "mae_dy": 0.0015487896744161844,
      "pose_mae_dtheta": 0.05161549150943756,
      "pose_mae_dx": 0.012612039223313332,
      "pose_mae_dy": 0.024669671431183815,
      "pose_rmse_dtheta": 0.16457484662532806,
      "pose_rmse_dx": 0.03166922554373741,
      "pose_rmse_dy": 0.07294195145368576,
      "pose_rmse_mean": 0.08972867578268051,
      "rmse_dtheta": 0.019670752808451653,
      "rmse_dx": 0.0022881943732500076,
      "rmse_dy": 0.003795165568590164,
      "rmse_mean": 0.008584704250097275,
      "rotation_flip": 0.005936073139309883,
      "sparse_tokens": 32089.0,
      "step": 7804,
      "turn_loss": 0.058767106384038925,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.3626184724028991,
      "grad_norm": 0.47048428654670715,
      "learning_rate": 2.774929379571396e-06,
      "loss": 0.165,
      "mae_dtheta": 0.03738296031951904,
      "mae_dx": 0.010488780215382576,
      "mae_dy": 0.0068624261766672134,
      "pose_mae_dtheta": 0.35934653878211975,
      "pose_mae_dx": 0.0654420480132103,
      "pose_mae_dy": 0.07345966249704361,
      "pose_rmse_dtheta": 0.5584215521812439,
      "pose_rmse_dx": 0.14270280301570892,
      "pose_rmse_dy": 0.22394613921642303,
      "pose_rmse_mean": 0.3083568513393402,
      "rmse_dtheta": 0.054262831807136536,
      "rmse_dx": 0.02223021350800991,
      "rmse_dy": 0.01661032997071743,
      "rmse_mean": 0.03103446029126644,
      "rotation_flip": 0.021834060549736023,
      "sparse_tokens": 7065.0,
      "step": 7805,
      "turn_loss": 0.3491033911705017,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.36266493216874185,
      "grad_norm": 0.6737392544746399,
      "learning_rate": 2.7737453790153853e-06,
      "loss": 0.1083,
      "mae_dtheta": 0.008756357245147228,
      "mae_dx": 0.0018745465204119682,
      "mae_dy": 0.0002945862361229956,
      "pose_mae_dtheta": 0.06633751839399338,
      "pose_mae_dx": 0.014155595563352108,
      "pose_mae_dy": 0.004516495857387781,
      "pose_rmse_dtheta": 0.256320595741272,
      "pose_rmse_dx": 0.03224100172519684,
      "pose_rmse_dy": 0.012882151640951633,
      "pose_rmse_mean": 0.10048124194145203,
      "rmse_dtheta": 0.029218710958957672,
      "rmse_dx": 0.00488943001255393,
      "rmse_dy": 0.0006910163792781532,
      "rmse_mean": 0.01159971859306097,
      "rotation_flip": 0.0010851871920749545,
      "sparse_tokens": 32249.0,
      "step": 7806,
      "turn_loss": 0.0473044328391552,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3627113919345846,
      "grad_norm": 0.43687188625335693,
      "learning_rate": 2.7725615341425526e-06,
      "loss": 0.1147,
      "mae_dtheta": 0.00982317142188549,
      "mae_dx": 0.002560497960075736,
      "mae_dy": 0.0027482034638524055,
      "pose_mae_dtheta": 0.06990180909633636,
      "pose_mae_dx": 0.025541609153151512,
      "pose_mae_dy": 0.030044298619031906,
      "pose_rmse_dtheta": 0.15328453481197357,
      "pose_rmse_dx": 0.08392980694770813,
      "pose_rmse_dy": 0.08412587642669678,
      "pose_rmse_mean": 0.10711340606212616,
      "rmse_dtheta": 0.01983669400215149,
      "rmse_dx": 0.008538280613720417,
      "rmse_dy": 0.00672552827745676,
      "rmse_mean": 0.011700167320668697,
      "rotation_flip": 0.008448800072073936,
      "sparse_tokens": 32153.0,
      "step": 7807,
      "turn_loss": 0.09247639030218124,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3627578517004274,
      "grad_norm": 0.30635249614715576,
      "learning_rate": 2.7713778450356883e-06,
      "loss": 0.0774,
      "mae_dtheta": 0.01034645363688469,
      "mae_dx": 0.0016058360924944282,
      "mae_dy": 0.002816149266436696,
      "pose_mae_dtheta": 0.06304752826690674,
      "pose_mae_dx": 0.023137232288718224,
      "pose_mae_dy": 0.030927762389183044,
      "pose_rmse_dtheta": 0.11536623537540436,
      "pose_rmse_dx": 0.05159732699394226,
      "pose_rmse_dy": 0.05973653122782707,
      "pose_rmse_mean": 0.07556670159101486,
      "rmse_dtheta": 0.01990305632352829,
      "rmse_dx": 0.004106197506189346,
      "rmse_dy": 0.005203342530876398,
      "rmse_mean": 0.009737532585859299,
      "rotation_flip": 0.005177993327379227,
      "sparse_tokens": 32105.0,
      "step": 7808,
      "turn_loss": 0.0959404855966568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.36280431146627024,
      "grad_norm": 0.555144190788269,
      "learning_rate": 2.7701943117775686e-06,
      "loss": 0.1822,
      "mae_dtheta": 0.007732518017292023,
      "mae_dx": 0.0013289577327668667,
      "mae_dy": 0.0018417760729789734,
      "pose_mae_dtheta": 0.054122038185596466,
      "pose_mae_dx": 0.019208673387765884,
      "pose_mae_dy": 0.02153082564473152,
      "pose_rmse_dtheta": 0.13896851241588593,
      "pose_rmse_dx": 0.06056199222803116,
      "pose_rmse_dy": 0.05815562605857849,
      "pose_rmse_mean": 0.08589538186788559,
      "rmse_dtheta": 0.019272401928901672,
      "rmse_dx": 0.004658124875277281,
      "rmse_dy": 0.004542445298284292,
      "rmse_mean": 0.00949099101126194,
      "rotation_flip": 0.004870920442044735,
      "sparse_tokens": 32073.0,
      "step": 7809,
      "turn_loss": 0.06561467051506042,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.362850771232113,
      "grad_norm": 0.5808553695678711,
      "learning_rate": 2.7690109344509563e-06,
      "loss": 0.1107,
      "mae_dtheta": 0.04583514481782913,
      "mae_dx": 0.01735115982592106,
      "mae_dy": 0.00517189921811223,
      "pose_mae_dtheta": 0.343607097864151,
      "pose_mae_dx": 0.1357036530971527,
      "pose_mae_dy": 0.06888558715581894,
      "pose_rmse_dtheta": 0.5719524025917053,
      "pose_rmse_dx": 0.2708478271961212,
      "pose_rmse_dy": 0.14790993928909302,
      "pose_rmse_mean": 0.3302367329597473,
      "rmse_dtheta": 0.06259679049253464,
      "rmse_dx": 0.029995117336511612,
      "rmse_dy": 0.01090176496654749,
      "rmse_mean": 0.03449789434671402,
      "rotation_flip": 0.0066006602719426155,
      "sparse_tokens": 5229.0,
      "step": 7810,
      "turn_loss": 0.32786598801612854,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3628972309979558,
      "grad_norm": 0.5651376247406006,
      "learning_rate": 2.7678277131386085e-06,
      "loss": 0.1345,
      "mae_dtheta": 0.012353520840406418,
      "mae_dx": 0.0037430233787745237,
      "mae_dy": 0.0026796916499733925,
      "pose_mae_dtheta": 0.1019129678606987,
      "pose_mae_dx": 0.03936705365777016,
      "pose_mae_dy": 0.03513596951961517,
      "pose_rmse_dtheta": 0.27368804812431335,
      "pose_rmse_dx": 0.12589360773563385,
      "pose_rmse_dy": 0.1359838992357254,
      "pose_rmse_mean": 0.17852185666561127,
      "rmse_dtheta": 0.028553098440170288,
      "rmse_dx": 0.01217974815517664,
      "rmse_dy": 0.009201973676681519,
      "rmse_mean": 0.01664493978023529,
      "rotation_flip": 0.004626569803804159,
      "sparse_tokens": 32057.0,
      "step": 7811,
      "turn_loss": 0.09984581172466278,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31790.0,
      "epoch": 0.36294369076379857,
      "grad_norm": 0.8120676279067993,
      "learning_rate": 2.7666446479232644e-06,
      "loss": 0.2521,
      "mae_dtheta": 0.03591345250606537,
      "mae_dx": 0.010904357768595219,
      "mae_dy": 0.005871698725968599,
      "pose_mae_dtheta": 0.2669050693511963,
      "pose_mae_dx": 0.09191052615642548,
      "pose_mae_dy": 0.05154832825064659,
      "pose_rmse_dtheta": 0.4749143123626709,
      "pose_rmse_dx": 0.21019159257411957,
      "pose_rmse_dy": 0.13624171912670135,
      "pose_rmse_mean": 0.27378255128860474,
      "rmse_dtheta": 0.05500296875834465,
      "rmse_dx": 0.021730000153183937,
      "rmse_dy": 0.014662171714007854,
      "rmse_mean": 0.03046504780650139,
      "rotation_flip": 0.013203613460063934,
      "sparse_tokens": 25392.0,
      "step": 7812,
      "turn_loss": 0.284830242395401,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.36299015052964134,
      "grad_norm": 0.8111492991447449,
      "learning_rate": 2.7654617388876612e-06,
      "loss": 0.1619,
      "mae_dtheta": 0.022212382405996323,
      "mae_dx": 0.00527580501511693,
      "mae_dy": 0.005346816498786211,
      "pose_mae_dtheta": 0.14629779756069183,
      "pose_mae_dx": 0.048193641006946564,
      "pose_mae_dy": 0.0783323124051094,
      "pose_rmse_dtheta": 0.2964703142642975,
      "pose_rmse_dx": 0.09916213154792786,
      "pose_rmse_dy": 0.21274691820144653,
      "pose_rmse_mean": 0.20279312133789062,
      "rmse_dtheta": 0.03745836764574051,
      "rmse_dx": 0.013294383883476257,
      "rmse_dy": 0.009807826951146126,
      "rmse_mean": 0.020186860114336014,
      "rotation_flip": 0.01244813296943903,
      "sparse_tokens": 9153.0,
      "step": 7813,
      "turn_loss": 0.21677067875862122,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3630366102954841,
      "grad_norm": 0.37414056062698364,
      "learning_rate": 2.764278986114516e-06,
      "loss": 0.0921,
      "mae_dtheta": 0.007695467676967382,
      "mae_dx": 0.0012645409442484379,
      "mae_dy": 0.0016646164003759623,
      "pose_mae_dtheta": 0.05222013220191002,
      "pose_mae_dx": 0.015534583479166031,
      "pose_mae_dy": 0.020119931548833847,
      "pose_rmse_dtheta": 0.12691135704517365,
      "pose_rmse_dx": 0.050997987389564514,
      "pose_rmse_dy": 0.05193726345896721,
      "pose_rmse_mean": 0.07661554217338562,
      "rmse_dtheta": 0.016650835052132607,
      "rmse_dx": 0.004620915278792381,
      "rmse_dy": 0.003917848225682974,
      "rmse_mean": 0.008396533317863941,
      "rotation_flip": 0.003821656107902527,
      "sparse_tokens": 32057.0,
      "step": 7814,
      "turn_loss": 0.061359703540802,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3630830700613269,
      "grad_norm": 0.5990738868713379,
      "learning_rate": 2.7630963896865407e-06,
      "loss": 0.0765,
      "mae_dtheta": 0.00914933905005455,
      "mae_dx": 0.0017892014002427459,
      "mae_dy": 0.002048335736617446,
      "pose_mae_dtheta": 0.05971233919262886,
      "pose_mae_dx": 0.02098867855966091,
      "pose_mae_dy": 0.02271093986928463,
      "pose_rmse_dtheta": 0.18275536596775055,
      "pose_rmse_dx": 0.06823206692934036,
      "pose_rmse_dy": 0.06144733354449272,
      "pose_rmse_mean": 0.10414492338895798,
      "rmse_dtheta": 0.022012261673808098,
      "rmse_dx": 0.006803541909903288,
      "rmse_dy": 0.005294095724821091,
      "rmse_mean": 0.011369965970516205,
      "rotation_flip": 0.004191115032881498,
      "sparse_tokens": 32105.0,
      "step": 7815,
      "turn_loss": 0.07218244671821594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.3631295298271697,
      "grad_norm": 0.5996254086494446,
      "learning_rate": 2.761913949686438e-06,
      "loss": 0.1703,
      "mae_dtheta": 0.03454897180199623,
      "mae_dx": 0.01378793828189373,
      "mae_dy": 0.007855771109461784,
      "pose_mae_dtheta": 0.24670153856277466,
      "pose_mae_dx": 0.11948569118976593,
      "pose_mae_dy": 0.07585810869932175,
      "pose_rmse_dtheta": 0.4300731122493744,
      "pose_rmse_dx": 0.24557045102119446,
      "pose_rmse_dy": 0.15761370956897736,
      "pose_rmse_mean": 0.27775242924690247,
      "rmse_dtheta": 0.05187632516026497,
      "rmse_dx": 0.026753369718790054,
      "rmse_dy": 0.015510299243032932,
      "rmse_mean": 0.03137999773025513,
      "rotation_flip": 0.012578615918755531,
      "sparse_tokens": 18574.0,
      "step": 7816,
      "turn_loss": 0.3395727574825287,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.36317598959301245,
      "grad_norm": 0.5186117887496948,
      "learning_rate": 2.760731666196892e-06,
      "loss": 0.1497,
      "mae_dtheta": 0.013260621577501297,
      "mae_dx": 0.0014568896731361747,
      "mae_dy": 0.002369101159274578,
      "pose_mae_dtheta": 0.08423199504613876,
      "pose_mae_dx": 0.021482637152075768,
      "pose_mae_dy": 0.028148334473371506,
      "pose_rmse_dtheta": 0.22837556898593903,
      "pose_rmse_dx": 0.05535563826560974,
      "pose_rmse_dy": 0.06816442310810089,
      "pose_rmse_mean": 0.11729854345321655,
      "rmse_dtheta": 0.028204213827848434,
      "rmse_dx": 0.003981441259384155,
      "rmse_dy": 0.004578402265906334,
      "rmse_mean": 0.012254685163497925,
      "rotation_flip": 0.008179958909749985,
      "sparse_tokens": 32105.0,
      "step": 7817,
      "turn_loss": 0.10067374259233475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3632224493588552,
      "grad_norm": 0.32859495282173157,
      "learning_rate": 2.7595495393005843e-06,
      "loss": 0.0973,
      "mae_dtheta": 0.009450109675526619,
      "mae_dx": 0.0017471677856519818,
      "mae_dy": 0.002750638173893094,
      "pose_mae_dtheta": 0.06342985481023788,
      "pose_mae_dx": 0.029341550543904305,
      "pose_mae_dy": 0.03244290128350258,
      "pose_rmse_dtheta": 0.1426437646150589,
      "pose_rmse_dx": 0.07478426396846771,
      "pose_rmse_dy": 0.07986168563365936,
      "pose_rmse_mean": 0.09909658133983612,
      "rmse_dtheta": 0.019506432116031647,
      "rmse_dx": 0.004732324276119471,
      "rmse_dy": 0.005839618854224682,
      "rmse_mean": 0.010026125237345695,
      "rotation_flip": 0.004145937040448189,
      "sparse_tokens": 32057.0,
      "step": 7818,
      "turn_loss": 0.08459462970495224,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32339.0,
      "epoch": 0.363268909124698,
      "grad_norm": 0.4439423680305481,
      "learning_rate": 2.758367569080178e-06,
      "loss": 0.1251,
      "mae_dtheta": 0.02759649232029915,
      "mae_dx": 0.011212790384888649,
      "mae_dy": 0.003954856190830469,
      "pose_mae_dtheta": 0.2172011286020279,
      "pose_mae_dx": 0.09171180427074432,
      "pose_mae_dy": 0.04333920776844025,
      "pose_rmse_dtheta": 0.4125079810619354,
      "pose_rmse_dx": 0.1941344439983368,
      "pose_rmse_dy": 0.10537633299827576,
      "pose_rmse_mean": 0.237339586019516,
      "rmse_dtheta": 0.04513410106301308,
      "rmse_dx": 0.022239940240979195,
      "rmse_dy": 0.008489527739584446,
      "rmse_mean": 0.02528785727918148,
      "rotation_flip": 0.014150943607091904,
      "sparse_tokens": 25726.0,
      "step": 7819,
      "turn_loss": 0.22466228902339935,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 8463.0,
      "epoch": 0.3633153688905408,
      "grad_norm": 0.49983832240104675,
      "learning_rate": 2.757185755618333e-06,
      "loss": 0.0784,
      "mae_dtheta": 0.03205670043826103,
      "mae_dx": 0.005476835183799267,
      "mae_dy": 0.005626876372843981,
      "pose_mae_dtheta": 0.2686920464038849,
      "pose_mae_dx": 0.056811537593603134,
      "pose_mae_dy": 0.07822161167860031,
      "pose_rmse_dtheta": 0.5185965299606323,
      "pose_rmse_dx": 0.13084393739700317,
      "pose_rmse_dy": 0.19285310804843903,
      "pose_rmse_mean": 0.28076452016830444,
      "rmse_dtheta": 0.05357975885272026,
      "rmse_dx": 0.014594790525734425,
      "rmse_dy": 0.011473127640783787,
      "rmse_mean": 0.02654922567307949,
      "rotation_flip": 0.007894736714661121,
      "sparse_tokens": 7018.0,
      "step": 7820,
      "turn_loss": 0.26158687472343445,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.36336182865638356,
      "grad_norm": 0.5122277736663818,
      "learning_rate": 2.7560040989976894e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.011691921390593052,
      "mae_dx": 0.0026967304293066263,
      "mae_dy": 0.003965096548199654,
      "pose_mae_dtheta": 0.07859885692596436,
      "pose_mae_dx": 0.03521008789539337,
      "pose_mae_dy": 0.03472946584224701,
      "pose_rmse_dtheta": 0.14999720454216003,
      "pose_rmse_dx": 0.0856015533208847,
      "pose_rmse_dy": 0.07284444570541382,
      "pose_rmse_mean": 0.10281439870595932,
      "rmse_dtheta": 0.021723493933677673,
      "rmse_dx": 0.006553454790264368,
      "rmse_dy": 0.00866954680532217,
      "rmse_mean": 0.012315498664975166,
      "rotation_flip": 0.004330446477979422,
      "sparse_tokens": 32137.0,
      "step": 7821,
      "turn_loss": 0.12258057296276093,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.36340828842222633,
      "grad_norm": 0.515579342842102,
      "learning_rate": 2.7548225993008837e-06,
      "loss": 0.1218,
      "mae_dtheta": 0.008348249830305576,
      "mae_dx": 0.0014270060928538442,
      "mae_dy": 0.0012414826778694987,
      "pose_mae_dtheta": 0.056114405393600464,
      "pose_mae_dx": 0.016156239435076714,
      "pose_mae_dy": 0.0179035272449255,
      "pose_rmse_dtheta": 0.17955338954925537,
      "pose_rmse_dx": 0.045840784907341,
      "pose_rmse_dy": 0.04580170661211014,
      "pose_rmse_mean": 0.0903986319899559,
      "rmse_dtheta": 0.0219805259257555,
      "rmse_dx": 0.005030615255236626,
      "rmse_dy": 0.002683809492737055,
      "rmse_mean": 0.00989831704646349,
      "rotation_flip": 0.004283674526959658,
      "sparse_tokens": 32105.0,
      "step": 7822,
      "turn_loss": 0.06461982429027557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3634547481880691,
      "grad_norm": 0.40168437361717224,
      "learning_rate": 2.753641256610541e-06,
      "loss": 0.0812,
      "mae_dtheta": 0.006768859922885895,
      "mae_dx": 0.0016636931104585528,
      "mae_dy": 0.0015729438746348023,
      "pose_mae_dtheta": 0.044706184417009354,
      "pose_mae_dx": 0.014963923022150993,
      "pose_mae_dy": 0.019345451146364212,
      "pose_rmse_dtheta": 0.11251405626535416,
      "pose_rmse_dx": 0.042699649930000305,
      "pose_rmse_dy": 0.08605772256851196,
      "pose_rmse_mean": 0.08042381703853607,
      "rmse_dtheta": 0.017778681591153145,
      "rmse_dx": 0.005232953932136297,
      "rmse_dy": 0.006664341781288385,
      "rmse_mean": 0.009891992434859276,
      "rotation_flip": 0.005529954098165035,
      "sparse_tokens": 32137.0,
      "step": 7823,
      "turn_loss": 0.06483881920576096,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3635012079539119,
      "grad_norm": 0.47975489497184753,
      "learning_rate": 2.7524600710092687e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.008718762546777725,
      "mae_dx": 0.0011569166090339422,
      "mae_dy": 0.0016407161019742489,
      "pose_mae_dtheta": 0.06106344982981682,
      "pose_mae_dx": 0.016178380697965622,
      "pose_mae_dy": 0.017358047887682915,
      "pose_rmse_dtheta": 0.22515763342380524,
      "pose_rmse_dx": 0.040454767644405365,
      "pose_rmse_dy": 0.04358765855431557,
      "pose_rmse_mean": 0.10306668281555176,
      "rmse_dtheta": 0.02537192776799202,
      "rmse_dx": 0.0033826755825430155,
      "rmse_dy": 0.0037459437735378742,
      "rmse_mean": 0.010833515785634518,
      "rotation_flip": 0.0013274336233735085,
      "sparse_tokens": 32089.0,
      "step": 7824,
      "turn_loss": 0.05548735707998276,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.3635476677197547,
      "grad_norm": 1.010542631149292,
      "learning_rate": 2.751279042579672e-06,
      "loss": 0.2711,
      "mae_dtheta": 0.03983167186379433,
      "mae_dx": 0.022311318665742874,
      "mae_dy": 0.021088507026433945,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999992251396179,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 121.2306900024414,
      "model/head/act_norm_mean": 95.79751247829861,
      "model/head/act_norm_min": 80.0674819946289,
      "model/head/act_over_embed": 65.83294744552906,
      "model/head/grad_frac": 0.10898976027965546,
      "model/head/grad_norm": 0.10898967832326889,
      "model/head/grad_zero_frac": 0.0001792585535440594,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7134331597222222,
      "model/head/update_ratio": 0.0018573077395558357,
      "model/head/weight_delta": 9.63929557800293,
      "model/head/weight_delta_rel": 0.1691017895936966,
      "model/head/weight_norm": 58.681541442871094,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223105311393738,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222590923309326,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42221537232398987,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901804015017238,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11559294164180756,
      "model/modality_embedder.encoders.pose/grad_norm": 0.1155928522348404,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5439453125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0037332093343138695,
      "model/modality_embedder.encoders.pose/weight_delta": 3.080596446990967,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10065268725156784,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96339988708496,
      "model/modality_embedder/grad_frac": 0.11559294164180756,
      "model/modality_embedder/grad_norm": 0.1155928522348404,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5439453125,
      "model/modality_embedder/update_ratio": 0.0037332093343138695,
      "model/modality_embedder/weight_delta": 3.080596446990967,
      "model/modality_embedder/weight_delta_rel": 0.10065268725156784,
      "model/modality_embedder/weight_norm": 30.96339988708496,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 68.29651641845703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.26882164902998,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.39500617980957,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.3033427212064,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06790618598461151,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06790613383054733,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00034800678258761764,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002431835513561964,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5728607177734375,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09375659376382828,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.923818588256836,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 69.5295181274414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 22.98221519510582,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.856127738952637,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.793593444965323,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0705900490283966,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07058999687433243,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00037322466960176826,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0023759426549077034,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.263697862625122,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11305704712867737,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.710311889648438,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 70.71788024902344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.50599371693122,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.936678886413574,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 16.84074831100302,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06258882582187653,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06258877366781235,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00044887830154038966,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0020402211230248213,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5263543128967285,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11840837448835373,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.677446365356445,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 71.15155792236328,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.73578559027778,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.397088050842285,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.373082162007194,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.053706374019384384,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0537063330411911,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0004539218789432198,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017959402175620198,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0197274684906006,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10319995135068893,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.904298782348633,
      "model/normalizer/grad_frac": 0.2247357815504074,
      "model/normalizer/grad_norm": 0.22473560273647308,
      "model/normalizer/grad_zero_frac": 0.0003970641118939966,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002859613625332713,
      "model/normalizer/weight_delta": 6.375822067260742,
      "model/normalizer/weight_delta_rel": 0.08211689442396164,
      "model/normalizer/weight_norm": 78.5895004272461,
      "pose_mae_dtheta": 0.2478531301021576,
      "pose_mae_dx": 0.20617713034152985,
      "pose_mae_dy": 0.24238498508930206,
      "pose_rmse_dtheta": 0.35619819164276123,
      "pose_rmse_dx": 0.3460330069065094,
      "pose_rmse_dy": 0.39013734459877014,
      "pose_rmse_mean": 0.36412283778190613,
      "rmse_dtheta": 0.053166624158620834,
      "rmse_dx": 0.03462843596935272,
      "rmse_dy": 0.033048324286937714,
      "rmse_mean": 0.040281131863594055,
      "rotation_flip": 0.028368793427944183,
      "sparse_tokens": 2253.0,
      "step": 7825,
      "turn_loss": 0.4254078269004822,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3635941274855975,
      "grad_norm": 0.6923468112945557,
      "learning_rate": 2.7500981714043367e-06,
      "loss": 0.1503,
      "mae_dtheta": 0.014861555770039558,
      "mae_dx": 0.0035278608556836843,
      "mae_dy": 0.0033867661841213703,
      "pose_mae_dtheta": 0.10574566572904587,
      "pose_mae_dx": 0.034991536289453506,
      "pose_mae_dy": 0.0354144386947155,
      "pose_rmse_dtheta": 0.2315979152917862,
      "pose_rmse_dx": 0.09191641956567764,
      "pose_rmse_dy": 0.08424686640501022,
      "pose_rmse_mean": 0.13592040538787842,
      "rmse_dtheta": 0.028522932901978493,
      "rmse_dx": 0.010250944644212723,
      "rmse_dy": 0.008854574523866177,
      "rmse_mean": 0.015876151621341705,
      "rotation_flip": 0.005923732183873653,
      "sparse_tokens": 32137.0,
      "step": 7826,
      "turn_loss": 0.1396382749080658,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3636405872514403,
      "grad_norm": 0.7709282040596008,
      "learning_rate": 2.748917457565844e-06,
      "loss": 0.1826,
      "mae_dtheta": 0.014638696797192097,
      "mae_dx": 0.0027039526030421257,
      "mae_dy": 0.0038676224648952484,
      "pose_mae_dtheta": 0.09433989226818085,
      "pose_mae_dx": 0.02731953375041485,
      "pose_mae_dy": 0.0349767804145813,
      "pose_rmse_dtheta": 0.23286072909832,
      "pose_rmse_dx": 0.061373282223939896,
      "pose_rmse_dy": 0.07735436409711838,
      "pose_rmse_mean": 0.12386279553174973,
      "rmse_dtheta": 0.02951235882937908,
      "rmse_dx": 0.009098334237933159,
      "rmse_dy": 0.009582552127540112,
      "rmse_mean": 0.016064416617155075,
      "rotation_flip": 0.006903693545609713,
      "sparse_tokens": 32105.0,
      "step": 7827,
      "turn_loss": 0.13891705870628357,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.36368704701728305,
      "grad_norm": 0.40193113684654236,
      "learning_rate": 2.7477369011467636e-06,
      "loss": 0.1055,
      "mae_dtheta": 0.01171436719596386,
      "mae_dx": 0.0021386989392340183,
      "mae_dy": 0.0033433667849749327,
      "pose_mae_dtheta": 0.07458159327507019,
      "pose_mae_dx": 0.024093590676784515,
      "pose_mae_dy": 0.030808603391051292,
      "pose_rmse_dtheta": 0.16665233671665192,
      "pose_rmse_dx": 0.057401757687330246,
      "pose_rmse_dy": 0.06354781985282898,
      "pose_rmse_mean": 0.09586730599403381,
      "rmse_dtheta": 0.024345338344573975,
      "rmse_dx": 0.006267491262406111,
      "rmse_dy": 0.007203580811619759,
      "rmse_mean": 0.012605471536517143,
      "rotation_flip": 0.0059947543777525425,
      "sparse_tokens": 32057.0,
      "step": 7828,
      "turn_loss": 0.1011325791478157,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.3637335067831258,
      "grad_norm": 0.38155218958854675,
      "learning_rate": 2.7465565022296493e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.04107268527150154,
      "mae_dx": 0.01725195161998272,
      "mae_dy": 0.005086052231490612,
      "pose_mae_dtheta": 0.35717225074768066,
      "pose_mae_dx": 0.13054266571998596,
      "pose_mae_dy": 0.062029775232076645,
      "pose_rmse_dtheta": 0.569092869758606,
      "pose_rmse_dx": 0.262724906206131,
      "pose_rmse_dy": 0.1558336764574051,
      "pose_rmse_mean": 0.3292171359062195,
      "rmse_dtheta": 0.05896773934364319,
      "rmse_dx": 0.029733899980783463,
      "rmse_dy": 0.010983774438500404,
      "rmse_mean": 0.033228471875190735,
      "rotation_flip": 0.004545454401522875,
      "sparse_tokens": 7105.0,
      "step": 7829,
      "turn_loss": 0.3147660493850708,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.3637799665489686,
      "grad_norm": 0.5861983895301819,
      "learning_rate": 2.7453762608970493e-06,
      "loss": 0.1263,
      "mae_dtheta": 0.03940938413143158,
      "mae_dx": 0.016322843730449677,
      "mae_dy": 0.008634477853775024,
      "pose_mae_dtheta": 0.2942751348018646,
      "pose_mae_dx": 0.13071581721305847,
      "pose_mae_dy": 0.06684373319149017,
      "pose_rmse_dtheta": 0.45426997542381287,
      "pose_rmse_dx": 0.24402453005313873,
      "pose_rmse_dy": 0.11885882169008255,
      "pose_rmse_mean": 0.2723844647407532,
      "rmse_dtheta": 0.053502604365348816,
      "rmse_dx": 0.027928374707698822,
      "rmse_dy": 0.015720689669251442,
      "rmse_mean": 0.032383888959884644,
      "rotation_flip": 0.01550387591123581,
      "sparse_tokens": 6719.0,
      "step": 7830,
      "turn_loss": 0.4263865649700165,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.3638264263148114,
      "grad_norm": 0.5514013171195984,
      "learning_rate": 2.744196177231498e-06,
      "loss": 0.1212,
      "mae_dtheta": 0.03303617238998413,
      "mae_dx": 0.013425643555819988,
      "mae_dy": 0.0050943586975336075,
      "pose_mae_dtheta": 0.2273143231868744,
      "pose_mae_dx": 0.11544055491685867,
      "pose_mae_dy": 0.06818017363548279,
      "pose_rmse_dtheta": 0.3624187707901001,
      "pose_rmse_dx": 0.25915631651878357,
      "pose_rmse_dy": 0.12745404243469238,
      "pose_rmse_mean": 0.2496763914823532,
      "rmse_dtheta": 0.047057121992111206,
      "rmse_dx": 0.026982184499502182,
      "rmse_dy": 0.008057794533669949,
      "rmse_mean": 0.027365703135728836,
      "rotation_flip": 0.01608910970389843,
      "sparse_tokens": 12970.0,
      "step": 7831,
      "turn_loss": 0.2801888585090637,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.36387288608065416,
      "grad_norm": 0.7542784810066223,
      "learning_rate": 2.743016251315517e-06,
      "loss": 0.1786,
      "mae_dtheta": 0.04565682262182236,
      "mae_dx": 0.011091929860413074,
      "mae_dy": 0.0083587896078825,
      "pose_mae_dtheta": 0.39561742544174194,
      "pose_mae_dx": 0.08801061660051346,
      "pose_mae_dy": 0.09462291747331619,
      "pose_rmse_dtheta": 0.6479746699333191,
      "pose_rmse_dx": 0.2058582752943039,
      "pose_rmse_dy": 0.22382956743240356,
      "pose_rmse_mean": 0.35922083258628845,
      "rmse_dtheta": 0.0637238547205925,
      "rmse_dx": 0.02212972193956375,
      "rmse_dy": 0.017045680433511734,
      "rmse_mean": 0.03429975360631943,
      "rotation_flip": 0.01705426350235939,
      "sparse_tokens": 10692.0,
      "step": 7832,
      "turn_loss": 0.3214488625526428,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.36391934584649693,
      "grad_norm": 0.33731502294540405,
      "learning_rate": 2.7418364832316225e-06,
      "loss": 0.0899,
      "mae_dtheta": 0.00832569319754839,
      "mae_dx": 0.0020809159614145756,
      "mae_dy": 0.0019260782282799482,
      "pose_mae_dtheta": 0.05846177414059639,
      "pose_mae_dx": 0.021932240575551987,
      "pose_mae_dy": 0.01806224137544632,
      "pose_rmse_dtheta": 0.19086132943630219,
      "pose_rmse_dx": 0.05899089574813843,
      "pose_rmse_dy": 0.046318963170051575,
      "pose_rmse_mean": 0.09872373193502426,
      "rmse_dtheta": 0.02288864180445671,
      "rmse_dx": 0.006225273944437504,
      "rmse_dy": 0.0047128284350037575,
      "rmse_mean": 0.0112755810841918,
      "rotation_flip": 0.0026362037751823664,
      "sparse_tokens": 32153.0,
      "step": 7833,
      "turn_loss": 0.08769491314888,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.3639658056123397,
      "grad_norm": 0.48494580388069153,
      "learning_rate": 2.7406568730623124e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.02946414053440094,
      "mae_dx": 0.013125208206474781,
      "mae_dy": 0.00804965291172266,
      "pose_mae_dtheta": 0.19869942963123322,
      "pose_mae_dx": 0.08871183544397354,
      "pose_mae_dy": 0.08354797214269638,
      "pose_rmse_dtheta": 0.31157186627388,
      "pose_rmse_dx": 0.15622331202030182,
      "pose_rmse_dy": 0.1850355565547943,
      "pose_rmse_mean": 0.21761023998260498,
      "rmse_dtheta": 0.04276454448699951,
      "rmse_dx": 0.023565631359815598,
      "rmse_dy": 0.01244737021625042,
      "rmse_mean": 0.026259183883666992,
      "rotation_flip": 0.04093567281961441,
      "sparse_tokens": 2912.0,
      "step": 7834,
      "turn_loss": 0.2649361491203308,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 13323.0,
      "epoch": 0.3640122653781825,
      "grad_norm": 0.48920199275016785,
      "learning_rate": 2.739477420890082e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.030147310346364975,
      "mae_dx": 0.011533776298165321,
      "mae_dy": 0.005969729740172625,
      "pose_mae_dtheta": 0.22279243171215057,
      "pose_mae_dx": 0.08639860153198242,
      "pose_mae_dy": 0.08673641085624695,
      "pose_rmse_dtheta": 0.40817388892173767,
      "pose_rmse_dx": 0.19851109385490417,
      "pose_rmse_dy": 0.20755919814109802,
      "pose_rmse_mean": 0.27141472697257996,
      "rmse_dtheta": 0.04827883467078209,
      "rmse_dx": 0.024645376950502396,
      "rmse_dy": 0.0120152048766613,
      "rmse_mean": 0.02831314131617546,
      "rotation_flip": 0.012987012974917889,
      "sparse_tokens": 10963.0,
      "step": 7835,
      "turn_loss": 0.24865569174289703,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.36405872514402526,
      "grad_norm": 0.383486807346344,
      "learning_rate": 2.7382981267974073e-06,
      "loss": 0.0837,
      "mae_dtheta": 0.009932025335729122,
      "mae_dx": 0.002959411358460784,
      "mae_dy": 0.0025640439707785845,
      "pose_mae_dtheta": 0.0651533380150795,
      "pose_mae_dx": 0.023100413382053375,
      "pose_mae_dy": 0.021677080541849136,
      "pose_rmse_dtheta": 0.1661338061094284,
      "pose_rmse_dx": 0.061534810811281204,
      "pose_rmse_dy": 0.05765141174197197,
      "pose_rmse_mean": 0.09510667622089386,
      "rmse_dtheta": 0.024086935445666313,
      "rmse_dx": 0.009530738927423954,
      "rmse_dy": 0.008522124961018562,
      "rmse_mean": 0.014046600088477135,
      "rotation_flip": 0.004468275234103203,
      "sparse_tokens": 32105.0,
      "step": 7836,
      "turn_loss": 0.11571758985519409,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.36410518490986804,
      "grad_norm": 0.5623314380645752,
      "learning_rate": 2.7371189908667604e-06,
      "loss": 0.1253,
      "mae_dtheta": 0.03169439360499382,
      "mae_dx": 0.008633027784526348,
      "mae_dy": 0.006630890071392059,
      "pose_mae_dtheta": 0.25845324993133545,
      "pose_mae_dx": 0.0838049054145813,
      "pose_mae_dy": 0.10513084381818771,
      "pose_rmse_dtheta": 0.4749981760978699,
      "pose_rmse_dx": 0.1881723701953888,
      "pose_rmse_dy": 0.20443210005760193,
      "pose_rmse_mean": 0.28920090198516846,
      "rmse_dtheta": 0.05220980569720268,
      "rmse_dx": 0.019240325316786766,
      "rmse_dy": 0.011348932981491089,
      "rmse_mean": 0.02759968861937523,
      "rotation_flip": 0.014598540030419827,
      "sparse_tokens": 7613.0,
      "step": 7837,
      "turn_loss": 0.18594990670681,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.3641516446757108,
      "grad_norm": 0.868972897529602,
      "learning_rate": 2.735940013180595e-06,
      "loss": 0.2444,
      "mae_dtheta": 0.025814523920416832,
      "mae_dx": 0.012155597098171711,
      "mae_dy": 0.00549571355804801,
      "pose_mae_dtheta": 0.18559004366397858,
      "pose_mae_dx": 0.09940172731876373,
      "pose_mae_dy": 0.06096319109201431,
      "pose_rmse_dtheta": 0.29208847880363464,
      "pose_rmse_dx": 0.20859912037849426,
      "pose_rmse_dy": 0.14502869546413422,
      "pose_rmse_mean": 0.2152387797832489,
      "rmse_dtheta": 0.0381111279129982,
      "rmse_dx": 0.023794690147042274,
      "rmse_dy": 0.010324612259864807,
      "rmse_mean": 0.024076810106635094,
      "rotation_flip": 0.02063789777457714,
      "sparse_tokens": 8572.0,
      "step": 7838,
      "turn_loss": 0.23175108432769775,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3641981044415536,
      "grad_norm": 0.5072094798088074,
      "learning_rate": 2.734761193821362e-06,
      "loss": 0.0942,
      "mae_dtheta": 0.007573944516479969,
      "mae_dx": 0.0013305690372362733,
      "mae_dy": 0.0013526214752346277,
      "pose_mae_dtheta": 0.047692954540252686,
      "pose_mae_dx": 0.014995623379945755,
      "pose_mae_dy": 0.01810525357723236,
      "pose_rmse_dtheta": 0.10902507603168488,
      "pose_rmse_dx": 0.037320759147405624,
      "pose_rmse_dy": 0.046778660267591476,
      "pose_rmse_mean": 0.06437483429908752,
      "rmse_dtheta": 0.017314162105321884,
      "rmse_dx": 0.004159803967922926,
      "rmse_dy": 0.002766221296042204,
      "rmse_mean": 0.00808006338775158,
      "rotation_flip": 0.0026840490754693747,
      "sparse_tokens": 32153.0,
      "step": 7839,
      "turn_loss": 0.06459584087133408,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.36424456420739637,
      "grad_norm": 0.5356265902519226,
      "learning_rate": 2.733582532871492e-06,
      "loss": 0.1001,
      "mae_dtheta": 0.007012730464339256,
      "mae_dx": 0.0012107371585443616,
      "mae_dy": 0.0011079533724114299,
      "pose_mae_dtheta": 0.045056454837322235,
      "pose_mae_dx": 0.012248657643795013,
      "pose_mae_dy": 0.01616141013801098,
      "pose_rmse_dtheta": 0.11981644481420517,
      "pose_rmse_dx": 0.02925238385796547,
      "pose_rmse_dy": 0.042155127972364426,
      "pose_rmse_mean": 0.06374132633209229,
      "rmse_dtheta": 0.018938850611448288,
      "rmse_dx": 0.003590551670640707,
      "rmse_dy": 0.002612290671095252,
      "rmse_mean": 0.008380564860999584,
      "rotation_flip": 0.005448449403047562,
      "sparse_tokens": 32185.0,
      "step": 7840,
      "turn_loss": 0.05355454608798027,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.36429102397323915,
      "grad_norm": 0.595333993434906,
      "learning_rate": 2.7324040304134125e-06,
      "loss": 0.1426,
      "mae_dtheta": 0.031438276171684265,
      "mae_dx": 0.015614490024745464,
      "mae_dy": 0.005058837588876486,
      "pose_mae_dtheta": 0.24349986016750336,
      "pose_mae_dx": 0.12417475134134293,
      "pose_mae_dy": 0.055120158940553665,
      "pose_rmse_dtheta": 0.39727410674095154,
      "pose_rmse_dx": 0.26920953392982483,
      "pose_rmse_dy": 0.13267552852630615,
      "pose_rmse_mean": 0.26638638973236084,
      "rmse_dtheta": 0.04780498147010803,
      "rmse_dx": 0.029063986614346504,
      "rmse_dy": 0.011236503720283508,
      "rmse_mean": 0.029368489980697632,
      "rotation_flip": 0.012631579302251339,
      "sparse_tokens": 8550.0,
      "step": 7841,
      "turn_loss": 0.2742252051830292,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.364337483739082,
      "grad_norm": 0.6556387543678284,
      "learning_rate": 2.731225686529538e-06,
      "loss": 0.0955,
      "mae_dtheta": 0.049274418503046036,
      "mae_dx": 0.016265200451016426,
      "mae_dy": 0.004814077168703079,
      "pose_mae_dtheta": 0.439975380897522,
      "pose_mae_dx": 0.1384245902299881,
      "pose_mae_dy": 0.060758061707019806,
      "pose_rmse_dtheta": 0.6709244251251221,
      "pose_rmse_dx": 0.27811500430107117,
      "pose_rmse_dy": 0.1507599651813507,
      "pose_rmse_mean": 0.36659979820251465,
      "rmse_dtheta": 0.06664898991584778,
      "rmse_dx": 0.029325108975172043,
      "rmse_dy": 0.009951546788215637,
      "rmse_mean": 0.03530855104327202,
      "rotation_flip": 0.01692865788936615,
      "sparse_tokens": 13033.0,
      "step": 7842,
      "turn_loss": 0.31549903750419617,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.36438394350492476,
      "grad_norm": 0.4529081881046295,
      "learning_rate": 2.7300475013022666e-06,
      "loss": 0.0879,
      "mae_dtheta": 0.010908070020377636,
      "mae_dx": 0.0013717262772843242,
      "mae_dy": 0.0027654769364744425,
      "pose_mae_dtheta": 0.06825076043605804,
      "pose_mae_dx": 0.02177809551358223,
      "pose_mae_dy": 0.0336562842130661,
      "pose_rmse_dtheta": 0.12502498924732208,
      "pose_rmse_dx": 0.0528329536318779,
      "pose_rmse_dy": 0.07544313371181488,
      "pose_rmse_mean": 0.08443369716405869,
      "rmse_dtheta": 0.0194076020270586,
      "rmse_dx": 0.003258002921938896,
      "rmse_dy": 0.005287730135023594,
      "rmse_mean": 0.009317778050899506,
      "rotation_flip": 0.007951653562486172,
      "sparse_tokens": 32121.0,
      "step": 7843,
      "turn_loss": 0.08890820294618607,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.36443040327076753,
      "grad_norm": 0.5103693008422852,
      "learning_rate": 2.7288694748139943e-06,
      "loss": 0.1289,
      "mae_dtheta": 0.006905967835336924,
      "mae_dx": 0.0010483189253136516,
      "mae_dy": 0.0005347399273887277,
      "pose_mae_dtheta": 0.05054016783833504,
      "pose_mae_dx": 0.009566057473421097,
      "pose_mae_dy": 0.009634163230657578,
      "pose_rmse_dtheta": 0.21581073105335236,
      "pose_rmse_dx": 0.022254804149270058,
      "pose_rmse_dy": 0.035034794360399246,
      "pose_rmse_mean": 0.0910334512591362,
      "rmse_dtheta": 0.025608165189623833,
      "rmse_dx": 0.0031184975523501635,
      "rmse_dy": 0.0013336316915228963,
      "rmse_mean": 0.010020098648965359,
      "rotation_flip": 0.0015353121561929584,
      "sparse_tokens": 32185.0,
      "step": 7844,
      "turn_loss": 0.03673616424202919,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3644768630366103,
      "grad_norm": 0.42763689160346985,
      "learning_rate": 2.727691607147096e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.009863637387752533,
      "mae_dx": 0.00170963688287884,
      "mae_dy": 0.0024484179448336363,
      "pose_mae_dtheta": 0.06500611454248428,
      "pose_mae_dx": 0.02138429880142212,
      "pose_mae_dy": 0.02850830741226673,
      "pose_rmse_dtheta": 0.1506446748971939,
      "pose_rmse_dx": 0.061074405908584595,
      "pose_rmse_dy": 0.06276944279670715,
      "pose_rmse_mean": 0.09149616956710815,
      "rmse_dtheta": 0.020155705511569977,
      "rmse_dx": 0.004661940969526768,
      "rmse_dy": 0.0051732780411839485,
      "rmse_mean": 0.009996974840760231,
      "rotation_flip": 0.005407353863120079,
      "sparse_tokens": 32105.0,
      "step": 7845,
      "turn_loss": 0.07894577085971832,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.3645233228024531,
      "grad_norm": 0.5344135165214539,
      "learning_rate": 2.726513898383944e-06,
      "loss": 0.1344,
      "mae_dtheta": 0.03259032219648361,
      "mae_dx": 0.00887199304997921,
      "mae_dy": 0.0037543133366853,
      "pose_mae_dtheta": 0.24608837068080902,
      "pose_mae_dx": 0.06721795350313187,
      "pose_mae_dy": 0.03956077620387077,
      "pose_rmse_dtheta": 0.47316065430641174,
      "pose_rmse_dx": 0.16630449891090393,
      "pose_rmse_dy": 0.10235672444105148,
      "pose_rmse_mean": 0.24727396667003632,
      "rmse_dtheta": 0.05131116136908531,
      "rmse_dx": 0.020019300282001495,
      "rmse_dy": 0.00850717443972826,
      "rmse_mean": 0.026612546294927597,
      "rotation_flip": 0.01616915501654148,
      "sparse_tokens": 14181.0,
      "step": 7846,
      "turn_loss": 0.2619076669216156,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.36456978256829586,
      "grad_norm": 0.5548856854438782,
      "learning_rate": 2.7253363486068967e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.03531242907047272,
      "mae_dx": 0.012667776085436344,
      "mae_dy": 0.004518731497228146,
      "pose_mae_dtheta": 0.2869848608970642,
      "pose_mae_dx": 0.10531103610992432,
      "pose_mae_dy": 0.051888369023799896,
      "pose_rmse_dtheta": 0.4955161213874817,
      "pose_rmse_dx": 0.2512553334236145,
      "pose_rmse_dy": 0.11401733756065369,
      "pose_rmse_mean": 0.2869296073913574,
      "rmse_dtheta": 0.05323043465614319,
      "rmse_dx": 0.02686265856027603,
      "rmse_dy": 0.009080673567950726,
      "rmse_mean": 0.029724588617682457,
      "rotation_flip": 0.013381995260715485,
      "sparse_tokens": 13003.0,
      "step": 7847,
      "turn_loss": 0.3012928366661072,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.36461624233413864,
      "grad_norm": 0.43325716257095337,
      "learning_rate": 2.724158957898298e-06,
      "loss": 0.074,
      "mae_dtheta": 0.013736491091549397,
      "mae_dx": 0.00313489674590528,
      "mae_dy": 0.004271975718438625,
      "pose_mae_dtheta": 0.09016205370426178,
      "pose_mae_dx": 0.038371000438928604,
      "pose_mae_dy": 0.04166312515735626,
      "pose_rmse_dtheta": 0.17873694002628326,
      "pose_rmse_dx": 0.09497378021478653,
      "pose_rmse_dy": 0.09192449599504471,
      "pose_rmse_mean": 0.12187840789556503,
      "rmse_dtheta": 0.025148853659629822,
      "rmse_dx": 0.008721798658370972,
      "rmse_dy": 0.008873025886714458,
      "rmse_mean": 0.0142478933557868,
      "rotation_flip": 0.01074870303273201,
      "sparse_tokens": 32073.0,
      "step": 7848,
      "turn_loss": 0.14506030082702637,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3646627020999814,
      "grad_norm": 0.5518249869346619,
      "learning_rate": 2.722981726340487e-06,
      "loss": 0.0813,
      "mae_dtheta": 0.007987129501998425,
      "mae_dx": 0.0021908327471464872,
      "mae_dy": 0.0012877618428319693,
      "pose_mae_dtheta": 0.0571722611784935,
      "pose_mae_dx": 0.022140761837363243,
      "pose_mae_dy": 0.017434202134609222,
      "pose_rmse_dtheta": 0.19433383643627167,
      "pose_rmse_dx": 0.06581099331378937,
      "pose_rmse_dy": 0.04193594679236412,
      "pose_rmse_mean": 0.10069359838962555,
      "rmse_dtheta": 0.02252250351011753,
      "rmse_dx": 0.008086496032774448,
      "rmse_dy": 0.002975564217194915,
      "rmse_mean": 0.011194854974746704,
      "rotation_flip": 0.0012845215387642384,
      "sparse_tokens": 32041.0,
      "step": 7849,
      "turn_loss": 0.0558011420071125,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3647091618658242,
      "grad_norm": 0.45540618896484375,
      "learning_rate": 2.721804654015783e-06,
      "loss": 0.0744,
      "mae_dtheta": 0.00825178436934948,
      "mae_dx": 0.0013363986508920789,
      "mae_dy": 0.0019187777070328593,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4554060995578766,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.4589080810547,
      "model/head/act_norm_mean": 108.57558988320707,
      "model/head/act_norm_min": 68.32894134521484,
      "model/head/act_over_embed": 74.61416186842762,
      "model/head/grad_frac": 0.07418966293334961,
      "model/head/grad_norm": 0.03378642350435257,
      "model/head/grad_zero_frac": 0.00021955206466373056,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7047772648358586,
      "model/head/update_ratio": 0.0005757446051575243,
      "model/head/weight_delta": 9.646498680114746,
      "model/head/weight_delta_rel": 0.16922816634178162,
      "model/head/weight_norm": 58.683006286621094,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223777949810028,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42229010064505673,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4222169518470764,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2902017107054943,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0984964445233345,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04485588148236275,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5297085201793722,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014486508443951607,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0837485790252686,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10075567662715912,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96390151977539,
      "model/modality_embedder/grad_frac": 0.0984964445233345,
      "model/modality_embedder/grad_norm": 0.04485588148236275,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5297085201793722,
      "model/modality_embedder/update_ratio": 0.0014486508443951607,
      "model/modality_embedder/weight_delta": 3.0837485790252686,
      "model/modality_embedder/weight_delta_rel": 0.10075567662715912,
      "model/modality_embedder/weight_norm": 30.96390151977539,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.22423553466797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.508352372935708,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.000370979309082,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.155159839343888,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.04556332156062126,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.020749814808368683,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007430777186527848,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.575568199157715,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09385526180267334,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.924152374267578,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.06100463867188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.51312981000481,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.332742691040039,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.845652300972347,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.04476882889866829,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02038799785077572,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0006862094742245972,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.267040967941284,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11317285150289536,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.711040496826172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.01236724853516,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.359798380631712,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.235507011413574,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.1147002314907,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.047126270830631256,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.021461591124534607,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0006995662115514278,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5303244590759277,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11854168772697449,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.67842674255371,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.7607421875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.106664361872696,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.753557205200195,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.31516288821649,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.04707849398255348,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02143983356654644,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007169362506829202,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0232467651367188,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10332022607326508,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.904796600341797,
      "model/normalizer/grad_frac": 0.16754204034805298,
      "model/normalizer/grad_norm": 0.07629966735839844,
      "model/normalizer/grad_zero_frac": 0.0002115311799570918,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.000970851571764797,
      "model/normalizer/weight_delta": 6.3828606605529785,
      "model/normalizer/weight_delta_rel": 0.08220755308866501,
      "model/normalizer/weight_norm": 78.5904541015625,
      "pose_mae_dtheta": 0.05225105211138725,
      "pose_mae_dx": 0.01721685752272606,
      "pose_mae_dy": 0.021537059918045998,
      "pose_rmse_dtheta": 0.11219305545091629,
      "pose_rmse_dx": 0.05113670229911804,
      "pose_rmse_dy": 0.05189792439341545,
      "pose_rmse_mean": 0.07174256443977356,
      "rmse_dtheta": 0.01698591746389866,
      "rmse_dx": 0.0037001960445195436,
      "rmse_dy": 0.004164410289376974,
      "rmse_mean": 0.008283508941531181,
      "rotation_flip": 0.008603832684457302,
      "sparse_tokens": 32105.0,
      "step": 7850,
      "turn_loss": 0.06720699369907379,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13283.0,
      "epoch": 0.36475562163166697,
      "grad_norm": 0.6203563809394836,
      "learning_rate": 2.720627741006505e-06,
      "loss": 0.1561,
      "mae_dtheta": 0.022801099345088005,
      "mae_dx": 0.007197756320238113,
      "mae_dy": 0.0035714448895305395,
      "pose_mae_dtheta": 0.1917390078306198,
      "pose_mae_dx": 0.06646984070539474,
      "pose_mae_dy": 0.06833359599113464,
      "pose_rmse_dtheta": 0.3721875548362732,
      "pose_rmse_dx": 0.17195828258991241,
      "pose_rmse_dy": 0.1448977291584015,
      "pose_rmse_mean": 0.22968117892742157,
      "rmse_dtheta": 0.03893587365746498,
      "rmse_dx": 0.018290888518095016,
      "rmse_dy": 0.006541479378938675,
      "rmse_mean": 0.021256079897284508,
      "rotation_flip": 0.0019685039296746254,
      "sparse_tokens": 10482.0,
      "step": 7851,
      "turn_loss": 0.17040885984897614,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.36480208139750975,
      "grad_norm": 0.5272386074066162,
      "learning_rate": 2.7194509873949504e-06,
      "loss": 0.1001,
      "mae_dtheta": 0.011898593045771122,
      "mae_dx": 0.0015937680145725608,
      "mae_dy": 0.0024267856497317553,
      "pose_mae_dtheta": 0.07878520339727402,
      "pose_mae_dx": 0.01973830536007881,
      "pose_mae_dy": 0.029281362891197205,
      "pose_rmse_dtheta": 0.20040760934352875,
      "pose_rmse_dx": 0.042494602501392365,
      "pose_rmse_dy": 0.0697539821267128,
      "pose_rmse_mean": 0.1042187362909317,
      "rmse_dtheta": 0.025294698774814606,
      "rmse_dx": 0.004071363713592291,
      "rmse_dy": 0.004667831584811211,
      "rmse_mean": 0.011344632133841515,
      "rotation_flip": 0.006391818635165691,
      "sparse_tokens": 32153.0,
      "step": 7852,
      "turn_loss": 0.0969909131526947,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36988.0,
      "epoch": 0.3648485411633525,
      "grad_norm": 0.5440281629562378,
      "learning_rate": 2.7182743932634125e-06,
      "loss": 0.1481,
      "mae_dtheta": 0.028431711718440056,
      "mae_dx": 0.010725907050073147,
      "mae_dy": 0.0051493472419679165,
      "pose_mae_dtheta": 0.20946063101291656,
      "pose_mae_dx": 0.0955110713839531,
      "pose_mae_dy": 0.06638791412115097,
      "pose_rmse_dtheta": 0.37118175625801086,
      "pose_rmse_dx": 0.21467116475105286,
      "pose_rmse_dy": 0.15142889320850372,
      "pose_rmse_mean": 0.24576060473918915,
      "rmse_dtheta": 0.04568568244576454,
      "rmse_dx": 0.02305346354842186,
      "rmse_dy": 0.009403406642377377,
      "rmse_mean": 0.026047518476843834,
      "rotation_flip": 0.013017751276493073,
      "sparse_tokens": 29788.0,
      "step": 7853,
      "turn_loss": 0.23240961134433746,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3648950009291953,
      "grad_norm": 0.37773317098617554,
      "learning_rate": 2.7170979586941725e-06,
      "loss": 0.0663,
      "mae_dtheta": 0.00783808995038271,
      "mae_dx": 0.0013599985977634788,
      "mae_dy": 0.0017690694658085704,
      "pose_mae_dtheta": 0.0538746640086174,
      "pose_mae_dx": 0.01897292584180832,
      "pose_mae_dy": 0.023079833015799522,
      "pose_rmse_dtheta": 0.15465636551380157,
      "pose_rmse_dx": 0.05248667299747467,
      "pose_rmse_dy": 0.06126236915588379,
      "pose_rmse_mean": 0.08946847170591354,
      "rmse_dtheta": 0.017801202833652496,
      "rmse_dx": 0.003768238006159663,
      "rmse_dy": 0.004233398009091616,
      "rmse_mean": 0.008600946515798569,
      "rotation_flip": 0.004973357077687979,
      "sparse_tokens": 32169.0,
      "step": 7854,
      "turn_loss": 0.0611555390059948,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.3649414606950381,
      "grad_norm": 0.5009315013885498,
      "learning_rate": 2.715921683769496e-06,
      "loss": 0.1517,
      "mae_dtheta": 0.035240184515714645,
      "mae_dx": 0.010726059786975384,
      "mae_dy": 0.007100749760866165,
      "pose_mae_dtheta": 0.2882829010486603,
      "pose_mae_dx": 0.07861422747373581,
      "pose_mae_dy": 0.09191242605447769,
      "pose_rmse_dtheta": 0.5040101408958435,
      "pose_rmse_dx": 0.18040700256824493,
      "pose_rmse_dy": 0.21647052466869354,
      "pose_rmse_mean": 0.300295889377594,
      "rmse_dtheta": 0.05379657447338104,
      "rmse_dx": 0.022650931030511856,
      "rmse_dy": 0.014283685944974422,
      "rmse_mean": 0.030243730172514915,
      "rotation_flip": 0.004950494971126318,
      "sparse_tokens": 16193.0,
      "step": 7855,
      "turn_loss": 0.2839100658893585,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.36498792046088085,
      "grad_norm": 0.37899139523506165,
      "learning_rate": 2.714745568571644e-06,
      "loss": 0.0846,
      "mae_dtheta": 0.008427523076534271,
      "mae_dx": 0.001394895138218999,
      "mae_dy": 0.00125616486184299,
      "pose_mae_dtheta": 0.05550241470336914,
      "pose_mae_dx": 0.014373806305229664,
      "pose_mae_dy": 0.015734506770968437,
      "pose_rmse_dtheta": 0.19558866322040558,
      "pose_rmse_dx": 0.037930794060230255,
      "pose_rmse_dy": 0.03976016864180565,
      "pose_rmse_mean": 0.09109321236610413,
      "rmse_dtheta": 0.023191718384623528,
      "rmse_dx": 0.005087723955512047,
      "rmse_dy": 0.003862070618197322,
      "rmse_mean": 0.010713838040828705,
      "rotation_flip": 0.00207125092856586,
      "sparse_tokens": 32137.0,
      "step": 7856,
      "turn_loss": 0.06361725181341171,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.36503438022672363,
      "grad_norm": 0.5728396773338318,
      "learning_rate": 2.713569613182859e-06,
      "loss": 0.1103,
      "mae_dtheta": 0.013339080847799778,
      "mae_dx": 0.002029102761298418,
      "mae_dy": 0.0036535849794745445,
      "pose_mae_dtheta": 0.08590061217546463,
      "pose_mae_dx": 0.032137200236320496,
      "pose_mae_dy": 0.03885582089424133,
      "pose_rmse_dtheta": 0.17146967351436615,
      "pose_rmse_dx": 0.09414112567901611,
      "pose_rmse_dy": 0.08348086476325989,
      "pose_rmse_mean": 0.11636389791965485,
      "rmse_dtheta": 0.023436864838004112,
      "rmse_dx": 0.006480868440121412,
      "rmse_dy": 0.007233031559735537,
      "rmse_mean": 0.012383589521050453,
      "rotation_flip": 0.006469500716775656,
      "sparse_tokens": 32073.0,
      "step": 7857,
      "turn_loss": 0.11143846064805984,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.36508083999256646,
      "grad_norm": 0.5717309713363647,
      "learning_rate": 2.7123938176853805e-06,
      "loss": 0.153,
      "mae_dtheta": 0.030528474599123,
      "mae_dx": 0.012054238468408585,
      "mae_dy": 0.00419128593057394,
      "pose_mae_dtheta": 0.20674003660678864,
      "pose_mae_dx": 0.0910729244351387,
      "pose_mae_dy": 0.0431729294359684,
      "pose_rmse_dtheta": 0.36881089210510254,
      "pose_rmse_dx": 0.1779087334871292,
      "pose_rmse_dy": 0.0993848517537117,
      "pose_rmse_mean": 0.2153681516647339,
      "rmse_dtheta": 0.046772804111242294,
      "rmse_dx": 0.02326032519340515,
      "rmse_dy": 0.009134824387729168,
      "rmse_mean": 0.026389319449663162,
      "rotation_flip": 0.0182232353836298,
      "sparse_tokens": 7309.0,
      "step": 7858,
      "turn_loss": 0.23333647847175598,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.36512729975840924,
      "grad_norm": 0.9766449928283691,
      "learning_rate": 2.7112181821614276e-06,
      "loss": 0.2016,
      "mae_dtheta": 0.027427159249782562,
      "mae_dx": 0.007580397184938192,
      "mae_dy": 0.0019169121515005827,
      "pose_mae_dtheta": 0.2035919576883316,
      "pose_mae_dx": 0.056584253907203674,
      "pose_mae_dy": 0.026828663423657417,
      "pose_rmse_dtheta": 0.4363059401512146,
      "pose_rmse_dx": 0.1622750163078308,
      "pose_rmse_dy": 0.07154914736747742,
      "pose_rmse_mean": 0.22337672114372253,
      "rmse_dtheta": 0.04942261800169945,
      "rmse_dx": 0.018919488415122032,
      "rmse_dy": 0.0052725481800735,
      "rmse_mean": 0.02453821711242199,
      "rotation_flip": 0.006768189370632172,
      "sparse_tokens": 13673.0,
      "step": 7859,
      "turn_loss": 0.1593160182237625,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 2946.0,
      "epoch": 0.365173759524252,
      "grad_norm": 0.40968674421310425,
      "learning_rate": 2.7100427066932156e-06,
      "loss": 0.1109,
      "mae_dtheta": 0.025935305282473564,
      "mae_dx": 0.01080822292715311,
      "mae_dy": 0.008413187228143215,
      "pose_mae_dtheta": 0.1918889582157135,
      "pose_mae_dx": 0.09186135977506638,
      "pose_mae_dy": 0.11326402425765991,
      "pose_rmse_dtheta": 0.2766367495059967,
      "pose_rmse_dx": 0.17482633888721466,
      "pose_rmse_dy": 0.21443094313144684,
      "pose_rmse_mean": 0.22196468710899353,
      "rmse_dtheta": 0.038226425647735596,
      "rmse_dx": 0.022560007870197296,
      "rmse_dy": 0.013958454132080078,
      "rmse_mean": 0.02491496317088604,
      "rotation_flip": 0.007092198356986046,
      "sparse_tokens": 2678.0,
      "step": 7860,
      "turn_loss": 0.36213353276252747,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.3652202192900948,
      "grad_norm": 0.76221764087677,
      "learning_rate": 2.708867391362948e-06,
      "loss": 0.1906,
      "mae_dtheta": 0.028848454356193542,
      "mae_dx": 0.010671637021005154,
      "mae_dy": 0.005778530612587929,
      "pose_mae_dtheta": 0.2008446902036667,
      "pose_mae_dx": 0.08737188577651978,
      "pose_mae_dy": 0.05416000634431839,
      "pose_rmse_dtheta": 0.39134299755096436,
      "pose_rmse_dx": 0.17903654277324677,
      "pose_rmse_dy": 0.12479384243488312,
      "pose_rmse_mean": 0.23172447085380554,
      "rmse_dtheta": 0.04774295166134834,
      "rmse_dx": 0.021466601639986038,
      "rmse_dy": 0.013502798974514008,
      "rmse_mean": 0.027570784091949463,
      "rotation_flip": 0.021699819713830948,
      "sparse_tokens": 9625.0,
      "step": 7861,
      "turn_loss": 0.23522257804870605,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.36526667905593757,
      "grad_norm": 0.4987758696079254,
      "learning_rate": 2.7076922362528124e-06,
      "loss": 0.123,
      "mae_dtheta": 0.007079978007823229,
      "mae_dx": 0.001542982761748135,
      "mae_dy": 0.0015838888939470053,
      "pose_mae_dtheta": 0.04596422240138054,
      "pose_mae_dx": 0.016219260171055794,
      "pose_mae_dy": 0.017247159034013748,
      "pose_rmse_dtheta": 0.12894496321678162,
      "pose_rmse_dx": 0.046150173991918564,
      "pose_rmse_dy": 0.04873655363917351,
      "pose_rmse_mean": 0.07461056858301163,
      "rmse_dtheta": 0.018470359966158867,
      "rmse_dx": 0.005334613844752312,
      "rmse_dy": 0.004126654472202063,
      "rmse_mean": 0.009310543537139893,
      "rotation_flip": 0.0036144577898085117,
      "sparse_tokens": 32089.0,
      "step": 7862,
      "turn_loss": 0.056165337562561035,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.36531313882178035,
      "grad_norm": 0.5555981993675232,
      "learning_rate": 2.7065172414449905e-06,
      "loss": 0.1129,
      "mae_dtheta": 0.011069398373365402,
      "mae_dx": 0.0021120915189385414,
      "mae_dy": 0.002148869913071394,
      "pose_mae_dtheta": 0.08393528312444687,
      "pose_mae_dx": 0.018251750618219376,
      "pose_mae_dy": 0.024825051426887512,
      "pose_rmse_dtheta": 0.23892274498939514,
      "pose_rmse_dx": 0.05512110888957977,
      "pose_rmse_dy": 0.08879520744085312,
      "pose_rmse_mean": 0.12761302292346954,
      "rmse_dtheta": 0.02680874429643154,
      "rmse_dx": 0.007385112810879946,
      "rmse_dy": 0.008187779225409031,
      "rmse_mean": 0.014127212576568127,
      "rotation_flip": 0.007146047428250313,
      "sparse_tokens": 32137.0,
      "step": 7863,
      "turn_loss": 0.08898615837097168,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.3653595985876231,
      "grad_norm": 0.5040586590766907,
      "learning_rate": 2.705342407021647e-06,
      "loss": 0.1124,
      "mae_dtheta": 0.03374776989221573,
      "mae_dx": 0.007396197412163019,
      "mae_dy": 0.00692087784409523,
      "pose_mae_dtheta": 0.2404482364654541,
      "pose_mae_dx": 0.07975161820650101,
      "pose_mae_dy": 0.10329607129096985,
      "pose_rmse_dtheta": 0.41865548491477966,
      "pose_rmse_dx": 0.17419525980949402,
      "pose_rmse_dy": 0.19116845726966858,
      "pose_rmse_mean": 0.2613397538661957,
      "rmse_dtheta": 0.05207224562764168,
      "rmse_dx": 0.018585506826639175,
      "rmse_dy": 0.01170385256409645,
      "rmse_mean": 0.027453869581222534,
      "rotation_flip": 0.012280701659619808,
      "sparse_tokens": 10379.0,
      "step": 7864,
      "turn_loss": 0.21741390228271484,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.3654060583534659,
      "grad_norm": 0.5749520659446716,
      "learning_rate": 2.7041677330649408e-06,
      "loss": 0.1498,
      "mae_dtheta": 0.03957591950893402,
      "mae_dx": 0.01194345485419035,
      "mae_dy": 0.00701281288638711,
      "pose_mae_dtheta": 0.3278556168079376,
      "pose_mae_dx": 0.10121455788612366,
      "pose_mae_dy": 0.11460598558187485,
      "pose_rmse_dtheta": 0.5753746032714844,
      "pose_rmse_dx": 0.21258340775966644,
      "pose_rmse_dy": 0.22208328545093536,
      "pose_rmse_mean": 0.33668047189712524,
      "rmse_dtheta": 0.057999387383461,
      "rmse_dx": 0.02494477480649948,
      "rmse_dy": 0.011390755884349346,
      "rmse_mean": 0.0314449742436409,
      "rotation_flip": 0.013463892042636871,
      "sparse_tokens": 13802.0,
      "step": 7865,
      "turn_loss": 0.30980655550956726,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.3654525181193087,
      "grad_norm": 0.7829003930091858,
      "learning_rate": 2.7029932196570188e-06,
      "loss": 0.2549,
      "mae_dtheta": 0.04471874609589577,
      "mae_dx": 0.01770700328052044,
      "mae_dy": 0.00921594724059105,
      "pose_mae_dtheta": 0.36271828413009644,
      "pose_mae_dx": 0.14551398158073425,
      "pose_mae_dy": 0.09077461063861847,
      "pose_rmse_dtheta": 0.6105023622512817,
      "pose_rmse_dx": 0.32641518115997314,
      "pose_rmse_dy": 0.24679765105247498,
      "pose_rmse_mean": 0.3945717513561249,
      "rmse_dtheta": 0.062421176582574844,
      "rmse_dx": 0.03105742111802101,
      "rmse_dy": 0.021969158202409744,
      "rmse_mean": 0.03848258778452873,
      "rotation_flip": 0.015075377188622952,
      "sparse_tokens": 9590.0,
      "step": 7866,
      "turn_loss": 0.3865872025489807,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.36549897788515145,
      "grad_norm": 0.4819682538509369,
      "learning_rate": 2.7018188668800123e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.010823247022926807,
      "mae_dx": 0.0011367792030796409,
      "mae_dy": 0.0023860076908022165,
      "pose_mae_dtheta": 0.0699385330080986,
      "pose_mae_dx": 0.0204597320407629,
      "pose_mae_dy": 0.03136071562767029,
      "pose_rmse_dtheta": 0.16864237189292908,
      "pose_rmse_dx": 0.05806093290448189,
      "pose_rmse_dy": 0.075462706387043,
      "pose_rmse_mean": 0.10072200745344162,
      "rmse_dtheta": 0.022513631731271744,
      "rmse_dx": 0.003113704966381192,
      "rmse_dy": 0.00509742321446538,
      "rmse_mean": 0.010241586714982986,
      "rotation_flip": 0.004449388012290001,
      "sparse_tokens": 32105.0,
      "step": 7867,
      "turn_loss": 0.08480316400527954,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.36554543765099423,
      "grad_norm": 0.378351628780365,
      "learning_rate": 2.7006446748160477e-06,
      "loss": 0.1131,
      "mae_dtheta": 0.043652452528476715,
      "mae_dx": 0.009870401583611965,
      "mae_dy": 0.006387493573129177,
      "pose_mae_dtheta": 0.3406485915184021,
      "pose_mae_dx": 0.07675907760858536,
      "pose_mae_dy": 0.08257931470870972,
      "pose_rmse_dtheta": 0.5860813856124878,
      "pose_rmse_dx": 0.16438934206962585,
      "pose_rmse_dy": 0.22548913955688477,
      "pose_rmse_mean": 0.32531997561454773,
      "rmse_dtheta": 0.06169365346431732,
      "rmse_dx": 0.021140052005648613,
      "rmse_dy": 0.012466194108128548,
      "rmse_mean": 0.031766634434461594,
      "rotation_flip": 0.017031630501151085,
      "sparse_tokens": 14029.0,
      "step": 7868,
      "turn_loss": 0.2738424837589264,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.365591897416837,
      "grad_norm": 0.44017472863197327,
      "learning_rate": 2.699470643547235e-06,
      "loss": 0.0913,
      "mae_dtheta": 0.008426095359027386,
      "mae_dx": 0.002586057875305414,
      "mae_dy": 0.0011742293136194348,
      "pose_mae_dtheta": 0.05095120146870613,
      "pose_mae_dx": 0.025890598073601723,
      "pose_mae_dy": 0.016819771379232407,
      "pose_rmse_dtheta": 0.12323272973299026,
      "pose_rmse_dx": 0.10778790712356567,
      "pose_rmse_dy": 0.04040812700986862,
      "pose_rmse_mean": 0.09047625958919525,
      "rmse_dtheta": 0.02112988568842411,
      "rmse_dx": 0.010728877037763596,
      "rmse_dy": 0.0025351070798933506,
      "rmse_mean": 0.011464624665677547,
      "rotation_flip": 0.011558021418750286,
      "sparse_tokens": 32089.0,
      "step": 7869,
      "turn_loss": 0.10108775645494461,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3656383571826798,
      "grad_norm": 0.507407009601593,
      "learning_rate": 2.698296773155673e-06,
      "loss": 0.0785,
      "mae_dtheta": 0.007706464733928442,
      "mae_dx": 0.0012380187399685383,
      "mae_dy": 0.0016767072957009077,
      "pose_mae_dtheta": 0.04957258701324463,
      "pose_mae_dx": 0.015495489351451397,
      "pose_mae_dy": 0.022841814905405045,
      "pose_rmse_dtheta": 0.09941742569208145,
      "pose_rmse_dx": 0.03621308505535126,
      "pose_rmse_dy": 0.05162437632679939,
      "pose_rmse_mean": 0.06241829693317413,
      "rmse_dtheta": 0.01618778146803379,
      "rmse_dx": 0.003390324767678976,
      "rmse_dy": 0.0033198047894984484,
      "rmse_mean": 0.007632637396454811,
      "rotation_flip": 0.003998545929789543,
      "sparse_tokens": 32137.0,
      "step": 7870,
      "turn_loss": 0.06751210242509842,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.36568481694852256,
      "grad_norm": 0.4213734269142151,
      "learning_rate": 2.6971230637234554e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.008091023191809654,
      "mae_dx": 0.001077724271453917,
      "mae_dy": 0.002007959643378854,
      "pose_mae_dtheta": 0.05134136229753494,
      "pose_mae_dx": 0.01662350818514824,
      "pose_mae_dy": 0.026126820594072342,
      "pose_rmse_dtheta": 0.1051318421959877,
      "pose_rmse_dx": 0.04025591164827347,
      "pose_rmse_dy": 0.05757645145058632,
      "pose_rmse_mean": 0.06765473634004593,
      "rmse_dtheta": 0.016110729426145554,
      "rmse_dx": 0.0036796426866203547,
      "rmse_dy": 0.004160325974225998,
      "rmse_mean": 0.007983566261827946,
      "rotation_flip": 0.006294256541877985,
      "sparse_tokens": 32057.0,
      "step": 7871,
      "turn_loss": 0.06224015727639198,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26933.0,
      "epoch": 0.36573127671436534,
      "grad_norm": 0.36446717381477356,
      "learning_rate": 2.6959495153326553e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.038059040904045105,
      "mae_dx": 0.00965972151607275,
      "mae_dy": 0.0041570719331502914,
      "pose_mae_dtheta": 0.30790576338768005,
      "pose_mae_dx": 0.08183272927999496,
      "pose_mae_dy": 0.03547859191894531,
      "pose_rmse_dtheta": 0.5323347449302673,
      "pose_rmse_dx": 0.18738658726215363,
      "pose_rmse_dy": 0.10924587398767471,
      "pose_rmse_mean": 0.2763224244117737,
      "rmse_dtheta": 0.05790739879012108,
      "rmse_dx": 0.020406804978847504,
      "rmse_dy": 0.00973218958824873,
      "rmse_mean": 0.029348796233534813,
      "rotation_flip": 0.02042483724653721,
      "sparse_tokens": 21852.0,
      "step": 7872,
      "turn_loss": 0.2375379353761673,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3657777364802081,
      "grad_norm": 0.4218943417072296,
      "learning_rate": 2.694776128065345e-06,
      "loss": 0.0825,
      "mae_dtheta": 0.012323160655796528,
      "mae_dx": 0.0029637475963681936,
      "mae_dy": 0.0034030184615403414,
      "pose_mae_dtheta": 0.08089689165353775,
      "pose_mae_dx": 0.026091404259204865,
      "pose_mae_dy": 0.032842978835105896,
      "pose_rmse_dtheta": 0.18035148084163666,
      "pose_rmse_dx": 0.06580039113759995,
      "pose_rmse_dy": 0.08565481752157211,
      "pose_rmse_mean": 0.1106022298336029,
      "rmse_dtheta": 0.025397246703505516,
      "rmse_dx": 0.009037540294229984,
      "rmse_dy": 0.007893002592027187,
      "rmse_mean": 0.014109264127910137,
      "rotation_flip": 0.006888633593916893,
      "sparse_tokens": 32105.0,
      "step": 7873,
      "turn_loss": 0.10478246957063675,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3658241962460509,
      "grad_norm": 0.46732184290885925,
      "learning_rate": 2.6936029020035754e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.010470871813595295,
      "mae_dx": 0.0013186823343858123,
      "mae_dy": 0.002714259084314108,
      "pose_mae_dtheta": 0.06881946325302124,
      "pose_mae_dx": 0.023587556555867195,
      "pose_mae_dy": 0.03364584222435951,
      "pose_rmse_dtheta": 0.13900475203990936,
      "pose_rmse_dx": 0.05961846187710762,
      "pose_rmse_dy": 0.07066206634044647,
      "pose_rmse_mean": 0.08976175636053085,
      "rmse_dtheta": 0.019639072939753532,
      "rmse_dx": 0.0035063510295003653,
      "rmse_dy": 0.00529160862788558,
      "rmse_mean": 0.009479011408984661,
      "rotation_flip": 0.006428571417927742,
      "sparse_tokens": 32057.0,
      "step": 7874,
      "turn_loss": 0.0842558965086937,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3658706560118937,
      "grad_norm": 0.442554771900177,
      "learning_rate": 2.6924298372293943e-06,
      "loss": 0.1315,
      "mae_dtheta": 0.011495971120893955,
      "mae_dx": 0.001563487807288766,
      "mae_dy": 0.0026913187466561794,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4425547420978546,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 154.8221893310547,
      "model/head/act_norm_mean": 107.93627683080808,
      "model/head/act_norm_min": 62.44337844848633,
      "model/head/act_over_embed": 74.17481995347593,
      "model/head/grad_frac": 0.11748691648244858,
      "model/head/grad_norm": 0.05199439078569412,
      "model/head/grad_zero_frac": 0.00019131487351842225,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7032039141414141,
      "model/head/update_ratio": 0.0008860074449330568,
      "model/head/weight_delta": 9.65257453918457,
      "model/head/weight_delta_rel": 0.1693347543478012,
      "model/head/weight_norm": 58.683921813964844,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223741888999939,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42230310914743,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4222273826599121,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2902106502701127,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09567804634571075,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04234277456998825,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5531143947963801,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013674714136868715,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0868031978607178,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10085548460483551,
      "model/modality_embedder.encoders.pose/weight_norm": 30.964284896850586,
      "model/modality_embedder/grad_frac": 0.09567804634571075,
      "model/modality_embedder/grad_norm": 0.04234277456998825,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5531143947963801,
      "model/modality_embedder/update_ratio": 0.0013674714136868715,
      "model/modality_embedder/weight_delta": 3.0868031978607178,
      "model/modality_embedder/weight_delta_rel": 0.10085548460483551,
      "model/modality_embedder/weight_norm": 30.964284896850586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.8329086303711,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.431111712361712,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.965072631835938,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.10207933425898,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07675398886203766,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.033967841416597366,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012163718929514289,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5789546966552734,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09397866576910019,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.925539016723633,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.44615936279297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.42296226150393,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.221611976623535,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.783688317480653,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08078782260417938,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.035753034055233,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0003026145859621465,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012032989179715514,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.270663022994995,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11329832673072815,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.712512969970703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.27172088623047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.267819564694566,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.606707572937012,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.051491528059454,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07940313220024109,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.035140231251716614,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00030765816336497664,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011453829938545823,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5343098640441895,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11867550760507584,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.67989730834961,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.16638946533203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.027464626422958,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.847262382507324,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.260736088535825,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0799625962972641,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03538782522082329,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011833031894639134,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0270209312438965,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10344921052455902,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.90596580505371,
      "model/normalizer/grad_frac": 0.274319589138031,
      "model/normalizer/grad_norm": 0.12140142917633057,
      "model/normalizer/grad_zero_frac": 0.0002717998286243528,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00154470419511199,
      "model/normalizer/weight_delta": 6.3904128074646,
      "model/normalizer/weight_delta_rel": 0.08230482041835785,
      "model/normalizer/weight_norm": 78.59202575683594,
      "pose_mae_dtheta": 0.08087415993213654,
      "pose_mae_dx": 0.023081740364432335,
      "pose_mae_dy": 0.029511451721191406,
      "pose_rmse_dtheta": 0.23133458197116852,
      "pose_rmse_dx": 0.07056228816509247,
      "pose_rmse_dy": 0.08172328770160675,
      "pose_rmse_mean": 0.12787339091300964,
      "rmse_dtheta": 0.025908684358000755,
      "rmse_dx": 0.004807539749890566,
      "rmse_dy": 0.006265292409807444,
      "rmse_mean": 0.012327171862125397,
      "rotation_flip": 0.0025916327722370625,
      "sparse_tokens": 32089.0,
      "step": 7875,
      "turn_loss": 0.0826059877872467,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.3659171157777365,
      "grad_norm": 0.4635077118873596,
      "learning_rate": 2.6912569338248317e-06,
      "loss": 0.105,
      "mae_dtheta": 0.028853008523583412,
      "mae_dx": 0.013015449047088623,
      "mae_dy": 0.003877595765516162,
      "pose_mae_dtheta": 0.2081865668296814,
      "pose_mae_dx": 0.10878954082727432,
      "pose_mae_dy": 0.04860500618815422,
      "pose_rmse_dtheta": 0.3676403760910034,
      "pose_rmse_dx": 0.23013266921043396,
      "pose_rmse_dy": 0.0974229946732521,
      "pose_rmse_mean": 0.23173204064369202,
      "rmse_dtheta": 0.045908380299806595,
      "rmse_dx": 0.024968473240733147,
      "rmse_dy": 0.00766454404219985,
      "rmse_mean": 0.026180466637015343,
      "rotation_flip": 0.016203703358769417,
      "sparse_tokens": 14868.0,
      "step": 7876,
      "turn_loss": 0.24423132836818695,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3659635755435793,
      "grad_norm": 0.4177241027355194,
      "learning_rate": 2.6900841918719122e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.004469582810997963,
      "mae_dx": 0.0007900417549535632,
      "mae_dy": 0.0010150530142709613,
      "pose_mae_dtheta": 0.032727114856243134,
      "pose_mae_dx": 0.011232738383114338,
      "pose_mae_dy": 0.015962958335876465,
      "pose_rmse_dtheta": 0.06570804864168167,
      "pose_rmse_dx": 0.029570940881967545,
      "pose_rmse_dy": 0.03799973428249359,
      "pose_rmse_mean": 0.044426243752241135,
      "rmse_dtheta": 0.010360409505665302,
      "rmse_dx": 0.0024570671375840902,
      "rmse_dy": 0.002185393124818802,
      "rmse_mean": 0.0050009568221867085,
      "rotation_flip": 0.0024557956494390965,
      "sparse_tokens": 32073.0,
      "step": 7877,
      "turn_loss": 0.03619769960641861,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.36601003530942205,
      "grad_norm": 0.6341907382011414,
      "learning_rate": 2.6889116114526435e-06,
      "loss": 0.0731,
      "mae_dtheta": 0.01309941802173853,
      "mae_dx": 0.0029321738984435797,
      "mae_dy": 0.004264472052454948,
      "pose_mae_dtheta": 0.09072385728359222,
      "pose_mae_dx": 0.03245295584201813,
      "pose_mae_dy": 0.040872205048799515,
      "pose_rmse_dtheta": 0.2135915905237198,
      "pose_rmse_dx": 0.08127275109291077,
      "pose_rmse_dy": 0.08785776048898697,
      "pose_rmse_mean": 0.12757404148578644,
      "rmse_dtheta": 0.026344550773501396,
      "rmse_dx": 0.00825016014277935,
      "rmse_dy": 0.010425047017633915,
      "rmse_mean": 0.015006585977971554,
      "rotation_flip": 0.0022197559010237455,
      "sparse_tokens": 32089.0,
      "step": 7878,
      "turn_loss": 0.12391455471515656,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.36605649507526483,
      "grad_norm": 0.3624940514564514,
      "learning_rate": 2.687739192649026e-06,
      "loss": 0.0917,
      "mae_dtheta": 0.0463065505027771,
      "mae_dx": 0.01310912799090147,
      "mae_dy": 0.005235944874584675,
      "pose_mae_dtheta": 0.39944764971733093,
      "pose_mae_dx": 0.11119703203439713,
      "pose_mae_dy": 0.05987263470888138,
      "pose_rmse_dtheta": 0.6520310044288635,
      "pose_rmse_dx": 0.23344741761684418,
      "pose_rmse_dy": 0.15529990196228027,
      "pose_rmse_mean": 0.34692615270614624,
      "rmse_dtheta": 0.066327303647995,
      "rmse_dx": 0.024877872318029404,
      "rmse_dy": 0.012721392326056957,
      "rmse_mean": 0.034642189741134644,
      "rotation_flip": 0.016597511246800423,
      "sparse_tokens": 8357.0,
      "step": 7879,
      "turn_loss": 0.2524532675743103,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.3661029548411076,
      "grad_norm": 0.4391738176345825,
      "learning_rate": 2.68656693554305e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.043755512684583664,
      "mae_dx": 0.015340236015617847,
      "mae_dy": 0.005253374110907316,
      "pose_mae_dtheta": 0.35923629999160767,
      "pose_mae_dx": 0.12611189484596252,
      "pose_mae_dy": 0.06302563846111298,
      "pose_rmse_dtheta": 0.6043471693992615,
      "pose_rmse_dx": 0.270959734916687,
      "pose_rmse_dy": 0.1810654252767563,
      "pose_rmse_mean": 0.35212409496307373,
      "rmse_dtheta": 0.06271392107009888,
      "rmse_dx": 0.02820878103375435,
      "rmse_dy": 0.012597168795764446,
      "rmse_mean": 0.034506622701883316,
      "rotation_flip": 0.015372168272733688,
      "sparse_tokens": 21331.0,
      "step": 7880,
      "turn_loss": 0.33214858174324036,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.3661494146069504,
      "grad_norm": 0.5766215324401855,
      "learning_rate": 2.685394840216688e-06,
      "loss": 0.1171,
      "mae_dtheta": 0.027418438345193863,
      "mae_dx": 0.010702807456254959,
      "mae_dy": 0.004607674665749073,
      "pose_mae_dtheta": 0.2069346308708191,
      "pose_mae_dx": 0.08036191761493683,
      "pose_mae_dy": 0.05086614936590195,
      "pose_rmse_dtheta": 0.3685573935508728,
      "pose_rmse_dx": 0.1802796721458435,
      "pose_rmse_dy": 0.10175192356109619,
      "pose_rmse_mean": 0.2168630063533783,
      "rmse_dtheta": 0.04156167805194855,
      "rmse_dx": 0.02274440787732601,
      "rmse_dy": 0.007847563363611698,
      "rmse_mean": 0.02405121736228466,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 7392.0,
      "step": 7881,
      "turn_loss": 0.18769513070583344,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.36619587437279316,
      "grad_norm": 0.34133848547935486,
      "learning_rate": 2.684222906751909e-06,
      "loss": 0.1124,
      "mae_dtheta": 0.010089173913002014,
      "mae_dx": 0.0020294017158448696,
      "mae_dy": 0.0028295426163822412,
      "pose_mae_dtheta": 0.06757812201976776,
      "pose_mae_dx": 0.019042978063225746,
      "pose_mae_dy": 0.024266889318823814,
      "pose_rmse_dtheta": 0.18055815994739532,
      "pose_rmse_dx": 0.05203935503959656,
      "pose_rmse_dy": 0.058086782693862915,
      "pose_rmse_mean": 0.0968947634100914,
      "rmse_dtheta": 0.023008234798908234,
      "rmse_dx": 0.005892677698284388,
      "rmse_dy": 0.0069760833866894245,
      "rmse_mean": 0.011958999559283257,
      "rotation_flip": 0.005584363825619221,
      "sparse_tokens": 32089.0,
      "step": 7882,
      "turn_loss": 0.08666575700044632,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.36624233413863594,
      "grad_norm": 0.6396166682243347,
      "learning_rate": 2.6830511352306632e-06,
      "loss": 0.1545,
      "mae_dtheta": 0.03053274005651474,
      "mae_dx": 0.011365015059709549,
      "mae_dy": 0.0034882863983511925,
      "pose_mae_dtheta": 0.2281608283519745,
      "pose_mae_dx": 0.08732607215642929,
      "pose_mae_dy": 0.0472000315785408,
      "pose_rmse_dtheta": 0.38878077268600464,
      "pose_rmse_dx": 0.18696041405200958,
      "pose_rmse_dy": 0.11366429924964905,
      "pose_rmse_mean": 0.22980181872844696,
      "rmse_dtheta": 0.04599766433238983,
      "rmse_dx": 0.023115869611501694,
      "rmse_dy": 0.006774008274078369,
      "rmse_mean": 0.02529584988951683,
      "rotation_flip": 0.023510972037911415,
      "sparse_tokens": 22345.0,
      "step": 7883,
      "turn_loss": 0.19977591931819916,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3662887939044787,
      "grad_norm": 0.41546928882598877,
      "learning_rate": 2.6818795257348945e-06,
      "loss": 0.0953,
      "mae_dtheta": 0.011324216611683369,
      "mae_dx": 0.0026527547743171453,
      "mae_dy": 0.0025970384012907743,
      "pose_mae_dtheta": 0.07635707408189774,
      "pose_mae_dx": 0.032727379351854324,
      "pose_mae_dy": 0.03015862964093685,
      "pose_rmse_dtheta": 0.19607511162757874,
      "pose_rmse_dx": 0.08963959664106369,
      "pose_rmse_dy": 0.068549744784832,
      "pose_rmse_mean": 0.11808815598487854,
      "rmse_dtheta": 0.023703061044216156,
      "rmse_dx": 0.008283723145723343,
      "rmse_dy": 0.005867493338882923,
      "rmse_mean": 0.012618092820048332,
      "rotation_flip": 0.003580379532650113,
      "sparse_tokens": 32089.0,
      "step": 7884,
      "turn_loss": 0.11369628459215164,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3663352536703215,
      "grad_norm": 0.5566769242286682,
      "learning_rate": 2.6807080783465376e-06,
      "loss": 0.1113,
      "mae_dtheta": 0.007279328070580959,
      "mae_dx": 0.0014904147246852517,
      "mae_dy": 0.001447148621082306,
      "pose_mae_dtheta": 0.046989500522613525,
      "pose_mae_dx": 0.017501823604106903,
      "pose_mae_dy": 0.017547640949487686,
      "pose_rmse_dtheta": 0.12980185449123383,
      "pose_rmse_dx": 0.05033696070313454,
      "pose_rmse_dy": 0.04194270446896553,
      "pose_rmse_mean": 0.0740271732211113,
      "rmse_dtheta": 0.01744689792394638,
      "rmse_dx": 0.005276303272694349,
      "rmse_dy": 0.0032883360981941223,
      "rmse_mean": 0.008670512586832047,
      "rotation_flip": 0.0018042399315163493,
      "sparse_tokens": 32105.0,
      "step": 7885,
      "turn_loss": 0.0553702637553215,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.36638171343616427,
      "grad_norm": 0.7198513746261597,
      "learning_rate": 2.679536793147507e-06,
      "loss": 0.1438,
      "mae_dtheta": 0.03247762843966484,
      "mae_dx": 0.002908344380557537,
      "mae_dy": 0.00048013965715654194,
      "pose_mae_dtheta": 0.28531742095947266,
      "pose_mae_dx": 0.02217564545571804,
      "pose_mae_dy": 0.0045919460244476795,
      "pose_rmse_dtheta": 0.6155386567115784,
      "pose_rmse_dx": 0.05151667445898056,
      "pose_rmse_dy": 0.010204053483903408,
      "pose_rmse_mean": 0.22575312852859497,
      "rmse_dtheta": 0.06171838194131851,
      "rmse_dx": 0.007843458093702793,
      "rmse_dy": 0.0009229216957464814,
      "rmse_mean": 0.023494919762015343,
      "rotation_flip": 0.014705882407724857,
      "sparse_tokens": 2869.0,
      "step": 7886,
      "turn_loss": 0.1734606921672821,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 18833.0,
      "epoch": 0.36642817320200705,
      "grad_norm": 0.4844242334365845,
      "learning_rate": 2.678365670219716e-06,
      "loss": 0.0963,
      "mae_dtheta": 0.020884374156594276,
      "mae_dx": 0.007975829765200615,
      "mae_dy": 0.0036767469719052315,
      "pose_mae_dtheta": 0.16297456622123718,
      "pose_mae_dx": 0.06756119430065155,
      "pose_mae_dy": 0.05393851920962334,
      "pose_rmse_dtheta": 0.3580110967159271,
      "pose_rmse_dx": 0.2132890522480011,
      "pose_rmse_dy": 0.16151154041290283,
      "pose_rmse_mean": 0.24427056312561035,
      "rmse_dtheta": 0.03949226811528206,
      "rmse_dx": 0.021392619237303734,
      "rmse_dy": 0.008186927065253258,
      "rmse_mean": 0.0230239387601614,
      "rotation_flip": 0.007923929952085018,
      "sparse_tokens": 15642.0,
      "step": 7887,
      "turn_loss": 0.14330457150936127,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.3664746329678498,
      "grad_norm": 0.5819545984268188,
      "learning_rate": 2.677194709645058e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.030971325933933258,
      "mae_dx": 0.0106552354991436,
      "mae_dy": 0.0059975082986056805,
      "pose_mae_dtheta": 0.22446386516094208,
      "pose_mae_dx": 0.08545735478401184,
      "pose_mae_dy": 0.06584634631872177,
      "pose_rmse_dtheta": 0.4224434494972229,
      "pose_rmse_dx": 0.19775328040122986,
      "pose_rmse_dy": 0.15734480321407318,
      "pose_rmse_mean": 0.2591805160045624,
      "rmse_dtheta": 0.049954093992710114,
      "rmse_dx": 0.023182909935712814,
      "rmse_dy": 0.01400422677397728,
      "rmse_mean": 0.029047077521681786,
      "rotation_flip": 0.011061946861445904,
      "sparse_tokens": 8215.0,
      "step": 7888,
      "turn_loss": 0.1971665769815445,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3665210927336926,
      "grad_norm": 0.6610674262046814,
      "learning_rate": 2.676023911505423e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.006223621778190136,
      "mae_dx": 0.0008826314588077366,
      "mae_dy": 0.0015278324717655778,
      "pose_mae_dtheta": 0.04036134108901024,
      "pose_mae_dx": 0.011371448636054993,
      "pose_mae_dy": 0.019274283200502396,
      "pose_rmse_dtheta": 0.08655761182308197,
      "pose_rmse_dx": 0.03198975697159767,
      "pose_rmse_dy": 0.04478319361805916,
      "pose_rmse_mean": 0.054443519562482834,
      "rmse_dtheta": 0.01284019835293293,
      "rmse_dx": 0.0032142328564077616,
      "rmse_dy": 0.003253653645515442,
      "rmse_mean": 0.006436028517782688,
      "rotation_flip": 0.002158894669264555,
      "sparse_tokens": 32057.0,
      "step": 7889,
      "turn_loss": 0.04747289419174194,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12675.0,
      "epoch": 0.3665675524995354,
      "grad_norm": 0.4759029746055603,
      "learning_rate": 2.6748532758826808e-06,
      "loss": 0.1239,
      "mae_dtheta": 0.029365094378590584,
      "mae_dx": 0.007598434574902058,
      "mae_dy": 0.0036959636490792036,
      "pose_mae_dtheta": 0.23544734716415405,
      "pose_mae_dx": 0.06790394335985184,
      "pose_mae_dy": 0.06109334155917168,
      "pose_rmse_dtheta": 0.43556079268455505,
      "pose_rmse_dx": 0.18598812818527222,
      "pose_rmse_dy": 0.15229715406894684,
      "pose_rmse_mean": 0.25794869661331177,
      "rmse_dtheta": 0.04631134867668152,
      "rmse_dx": 0.01959141157567501,
      "rmse_dy": 0.007824625819921494,
      "rmse_mean": 0.024575795978307724,
      "rotation_flip": 0.0,
      "sparse_tokens": 10004.0,
      "step": 7890,
      "turn_loss": 0.17661559581756592,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.3666140122653782,
      "grad_norm": 0.37996330857276917,
      "learning_rate": 2.673682802858697e-06,
      "loss": 0.0911,
      "mae_dtheta": 0.03176996856927872,
      "mae_dx": 0.011378551833331585,
      "mae_dy": 0.007480906322598457,
      "pose_mae_dtheta": 0.23594880104064941,
      "pose_mae_dx": 0.085487499833107,
      "pose_mae_dy": 0.08532315492630005,
      "pose_rmse_dtheta": 0.3836957812309265,
      "pose_rmse_dx": 0.20827923715114594,
      "pose_rmse_dy": 0.18370330333709717,
      "pose_rmse_mean": 0.2585594654083252,
      "rmse_dtheta": 0.0479869470000267,
      "rmse_dx": 0.024087775498628616,
      "rmse_dy": 0.015322857536375523,
      "rmse_mean": 0.029132528230547905,
      "rotation_flip": 0.02177293971180916,
      "sparse_tokens": 12061.0,
      "step": 7891,
      "turn_loss": 0.3603966236114502,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.366660472031221,
      "grad_norm": 0.44901397824287415,
      "learning_rate": 2.6725124925153258e-06,
      "loss": 0.1151,
      "mae_dtheta": 0.00758188683539629,
      "mae_dx": 0.0011586550390347838,
      "mae_dy": 0.0019237369997426867,
      "pose_mae_dtheta": 0.046740591526031494,
      "pose_mae_dx": 0.01783650927245617,
      "pose_mae_dy": 0.022669445723295212,
      "pose_rmse_dtheta": 0.09598974138498306,
      "pose_rmse_dx": 0.04596034064888954,
      "pose_rmse_dy": 0.05060896649956703,
      "pose_rmse_mean": 0.06418634951114655,
      "rmse_dtheta": 0.016126185655593872,
      "rmse_dx": 0.0036119776777923107,
      "rmse_dy": 0.0042405459098517895,
      "rmse_mean": 0.00799290370196104,
      "rotation_flip": 0.0023771789856255054,
      "sparse_tokens": 32057.0,
      "step": 7892,
      "turn_loss": 0.06152057647705078,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.36670693179706376,
      "grad_norm": 0.4682013690471649,
      "learning_rate": 2.6713423449344027e-06,
      "loss": 0.0926,
      "mae_dtheta": 0.0098666837438941,
      "mae_dx": 0.0015065973857417703,
      "mae_dy": 0.0034007192589342594,
      "pose_mae_dtheta": 0.056224238127470016,
      "pose_mae_dx": 0.027311230078339577,
      "pose_mae_dy": 0.028765616938471794,
      "pose_rmse_dtheta": 0.1060316264629364,
      "pose_rmse_dx": 0.07623908668756485,
      "pose_rmse_dy": 0.06849498301744461,
      "pose_rmse_mean": 0.08358856290578842,
      "rmse_dtheta": 0.018436528742313385,
      "rmse_dx": 0.0033609108068048954,
      "rmse_dy": 0.0072927880100905895,
      "rmse_mean": 0.00969674251973629,
      "rotation_flip": 0.003365870099514723,
      "sparse_tokens": 32153.0,
      "step": 7893,
      "turn_loss": 0.10459140688180923,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.36675339156290654,
      "grad_norm": 0.5755398869514465,
      "learning_rate": 2.6701723601977614e-06,
      "loss": 0.1957,
      "mae_dtheta": 0.013237410224974155,
      "mae_dx": 0.0034682187251746655,
      "mae_dy": 0.004648040980100632,
      "pose_mae_dtheta": 0.08911178261041641,
      "pose_mae_dx": 0.0448189340531826,
      "pose_mae_dy": 0.034580569714307785,
      "pose_rmse_dtheta": 0.19301314651966095,
      "pose_rmse_dx": 0.11399205029010773,
      "pose_rmse_dy": 0.07272177934646606,
      "pose_rmse_mean": 0.12657566368579865,
      "rmse_dtheta": 0.0270085446536541,
      "rmse_dx": 0.007772154174745083,
      "rmse_dy": 0.00977509655058384,
      "rmse_mean": 0.014851933345198631,
      "rotation_flip": 0.0061349691823124886,
      "sparse_tokens": 32185.0,
      "step": 7894,
      "turn_loss": 0.14025536179542542,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3667998513287493,
      "grad_norm": 0.4838997423648834,
      "learning_rate": 2.6690025383872155e-06,
      "loss": 0.1346,
      "mae_dtheta": 0.009868279099464417,
      "mae_dx": 0.0014455611817538738,
      "mae_dy": 0.0018878395203500986,
      "pose_mae_dtheta": 0.06886366009712219,
      "pose_mae_dx": 0.01775209978222847,
      "pose_mae_dy": 0.021566620096564293,
      "pose_rmse_dtheta": 0.20444928109645844,
      "pose_rmse_dx": 0.041748207062482834,
      "pose_rmse_dy": 0.050681427121162415,
      "pose_rmse_mean": 0.09895964711904526,
      "rmse_dtheta": 0.023735634982585907,
      "rmse_dx": 0.004491841420531273,
      "rmse_dy": 0.003900716546922922,
      "rmse_mean": 0.010709397494792938,
      "rotation_flip": 0.0029728724621236324,
      "sparse_tokens": 32137.0,
      "step": 7895,
      "turn_loss": 0.0652865469455719,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3668463110945921,
      "grad_norm": 0.53059983253479,
      "learning_rate": 2.667832879584575e-06,
      "loss": 0.1094,
      "mae_dtheta": 0.009976843371987343,
      "mae_dx": 0.0012181077618151903,
      "mae_dy": 0.002615442266687751,
      "pose_mae_dtheta": 0.06317876279354095,
      "pose_mae_dx": 0.01909603737294674,
      "pose_mae_dy": 0.03163277357816696,
      "pose_rmse_dtheta": 0.13321678340435028,
      "pose_rmse_dx": 0.0506594181060791,
      "pose_rmse_dy": 0.0822005569934845,
      "pose_rmse_mean": 0.08869224786758423,
      "rmse_dtheta": 0.020942574366927147,
      "rmse_dx": 0.0035602126736193895,
      "rmse_dy": 0.00610895361751318,
      "rmse_mean": 0.01020391471683979,
      "rotation_flip": 0.00804387591779232,
      "sparse_tokens": 32089.0,
      "step": 7896,
      "turn_loss": 0.09030898660421371,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.36689277086043487,
      "grad_norm": 0.3393896222114563,
      "learning_rate": 2.6666633838716317e-06,
      "loss": 0.0837,
      "mae_dtheta": 0.009465164504945278,
      "mae_dx": 0.0016181388637050986,
      "mae_dy": 0.0022916251327842474,
      "pose_mae_dtheta": 0.06417763978242874,
      "pose_mae_dx": 0.016741028055548668,
      "pose_mae_dy": 0.021892080083489418,
      "pose_rmse_dtheta": 0.19055423140525818,
      "pose_rmse_dx": 0.05003459006547928,
      "pose_rmse_dy": 0.052708663046360016,
      "pose_rmse_mean": 0.09776582568883896,
      "rmse_dtheta": 0.024010855704545975,
      "rmse_dx": 0.006128482986241579,
      "rmse_dy": 0.0065233223140239716,
      "rmse_mean": 0.012220887467265129,
      "rotation_flip": 0.004342162515968084,
      "sparse_tokens": 32073.0,
      "step": 7897,
      "turn_loss": 0.0888172909617424,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.36693923062627765,
      "grad_norm": 0.37154674530029297,
      "learning_rate": 2.66549405133017e-06,
      "loss": 0.0919,
      "mae_dtheta": 0.008401276543736458,
      "mae_dx": 0.0013492366997525096,
      "mae_dy": 0.0017497144872322679,
      "pose_mae_dtheta": 0.05372064560651779,
      "pose_mae_dx": 0.014480303041636944,
      "pose_mae_dy": 0.023111414164304733,
      "pose_rmse_dtheta": 0.11861728876829147,
      "pose_rmse_dx": 0.04134126007556915,
      "pose_rmse_dy": 0.054305221885442734,
      "pose_rmse_mean": 0.07142125815153122,
      "rmse_dtheta": 0.018330644816160202,
      "rmse_dx": 0.0049588922411203384,
      "rmse_dy": 0.0036784717813134193,
      "rmse_mean": 0.008989336900413036,
      "rotation_flip": 0.006860371213406324,
      "sparse_tokens": 32105.0,
      "step": 7898,
      "turn_loss": 0.07547362893819809,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.3669856903921204,
      "grad_norm": 1.111686110496521,
      "learning_rate": 2.6643248820419644e-06,
      "loss": 0.2713,
      "mae_dtheta": 0.02580764889717102,
      "mae_dx": 0.008913416415452957,
      "mae_dy": 0.0029666093178093433,
      "pose_mae_dtheta": 0.1816789209842682,
      "pose_mae_dx": 0.08155658096075058,
      "pose_mae_dy": 0.049687568098306656,
      "pose_rmse_dtheta": 0.3235880434513092,
      "pose_rmse_dx": 0.19709116220474243,
      "pose_rmse_dy": 0.12247767299413681,
      "pose_rmse_mean": 0.21438562870025635,
      "rmse_dtheta": 0.03984228894114494,
      "rmse_dx": 0.021254021674394608,
      "rmse_dy": 0.005259665660560131,
      "rmse_mean": 0.02211865782737732,
      "rotation_flip": 0.006507592275738716,
      "sparse_tokens": 7987.0,
      "step": 7899,
      "turn_loss": 0.20874793827533722,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 12636.0,
      "epoch": 0.3670321501579632,
      "grad_norm": 0.3303149938583374,
      "learning_rate": 2.663155876088771e-06,
      "loss": 0.093,
      "mae_dtheta": 0.02392624132335186,
      "mae_dx": 0.00575799448415637,
      "mae_dy": 0.0036027920432388783,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3303150236606598,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.16555786132812,
      "model/head/act_norm_mean": 114.06874749599359,
      "model/head/act_norm_min": 80.15608978271484,
      "model/head/act_over_embed": 78.38911120768634,
      "model/head/grad_frac": 0.12521028518676758,
      "model/head/grad_norm": 0.041358835995197296,
      "model/head/grad_zero_frac": 0.00019385304767638445,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7000951522435898,
      "model/head/update_ratio": 0.0007047572871670127,
      "model/head/weight_delta": 9.658265113830566,
      "model/head/weight_delta_rel": 0.1694345772266388,
      "model/head/weight_norm": 58.685218811035156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223577082157135,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4223577082157135,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4223577082157135,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29024817126100166,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10628864914178848,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03510873764753342,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011338487965986133,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0869107246398926,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10085899382829666,
      "model/modality_embedder.encoders.pose/weight_norm": 30.964216232299805,
      "model/modality_embedder/grad_frac": 0.10628864914178848,
      "model/modality_embedder/grad_norm": 0.03510873764753342,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0011338487965986133,
      "model/modality_embedder/weight_delta": 3.0869107246398926,
      "model/modality_embedder/weight_delta_rel": 0.10085899382829666,
      "model/modality_embedder/weight_norm": 30.964216232299805,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.69334411621094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.01676650895401,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.28657054901123,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.5045467934638,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07299673557281494,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.024111919105052948,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003379196277819574,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008634192636236548,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.581653118133545,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09407699853181839,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.926084518432617,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.0428466796875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.81241891788767,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.289304733276367,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.051326577898223,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0793585404753685,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02621331810951233,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0003429632051847875,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008822042145766318,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2741668224334717,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11341969668865204,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.713436126708984,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.65271759033203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.405375585063084,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.310516357421875,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.146021313076453,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07684173434972763,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02538198046386242,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008272880804724991,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5382509231567383,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1188078373670578,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.680946350097656,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.3360595703125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.24702380952381,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.752041816711426,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.41161921470819,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06986608356237411,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.023077817633748055,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007716557011008263,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0307505130767822,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1035766676068306,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.906883239746094,
      "model/normalizer/grad_frac": 0.23686951398849487,
      "model/normalizer/grad_norm": 0.07824155688285828,
      "model/normalizer/grad_zero_frac": 0.00030607025837525725,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0009955267887562513,
      "model/normalizer/weight_delta": 6.397579669952393,
      "model/normalizer/weight_delta_rel": 0.08239712566137314,
      "model/normalizer/weight_norm": 78.59312438964844,
      "pose_mae_dtheta": 0.16789613664150238,
      "pose_mae_dx": 0.051644787192344666,
      "pose_mae_dy": 0.036610282957553864,
      "pose_rmse_dtheta": 0.3137090802192688,
      "pose_rmse_dx": 0.13415274024009705,
      "pose_rmse_dy": 0.07590582966804504,
      "pose_rmse_mean": 0.17458921670913696,
      "rmse_dtheta": 0.039214640855789185,
      "rmse_dx": 0.015545714646577835,
      "rmse_dy": 0.0070597948506474495,
      "rmse_mean": 0.020606717094779015,
      "rotation_flip": 0.010327022522687912,
      "sparse_tokens": 9873.0,
      "step": 7900,
      "turn_loss": 0.2035398781299591,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 30170.0,
      "epoch": 0.367078609923806,
      "grad_norm": 0.4957987666130066,
      "learning_rate": 2.6619870335523434e-06,
      "loss": 0.1751,
      "mae_dtheta": 0.04032440111041069,
      "mae_dx": 0.01224158052355051,
      "mae_dy": 0.007352047134190798,
      "pose_mae_dtheta": 0.3082556128501892,
      "pose_mae_dx": 0.09578082710504532,
      "pose_mae_dy": 0.0705818459391594,
      "pose_rmse_dtheta": 0.5460245013237,
      "pose_rmse_dx": 0.20832762122154236,
      "pose_rmse_dy": 0.15286627411842346,
      "pose_rmse_mean": 0.3024061322212219,
      "rmse_dtheta": 0.05979739502072334,
      "rmse_dx": 0.024210302159190178,
      "rmse_dy": 0.01558233704417944,
      "rmse_mean": 0.03319668024778366,
      "rotation_flip": 0.015206372365355492,
      "sparse_tokens": 24789.0,
      "step": 7901,
      "turn_loss": 0.3353223204612732,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.36712506968964875,
      "grad_norm": 0.47660526633262634,
      "learning_rate": 2.660818354514416e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.009217850863933563,
      "mae_dx": 0.0023626256734132767,
      "mae_dy": 0.0023997128009796143,
      "pose_mae_dtheta": 0.06931696087121964,
      "pose_mae_dx": 0.027487238869071007,
      "pose_mae_dy": 0.02320386841893196,
      "pose_rmse_dtheta": 0.20900698006153107,
      "pose_rmse_dx": 0.08049143850803375,
      "pose_rmse_dy": 0.05943431705236435,
      "pose_rmse_mean": 0.11631091684103012,
      "rmse_dtheta": 0.024007292464375496,
      "rmse_dx": 0.006768944673240185,
      "rmse_dy": 0.005797709804028273,
      "rmse_mean": 0.012191316112875938,
      "rotation_flip": 0.0013786765048280358,
      "sparse_tokens": 32073.0,
      "step": 7902,
      "turn_loss": 0.0728876069188118,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.36717152945549153,
      "grad_norm": 0.515748918056488,
      "learning_rate": 2.659649839056716e-06,
      "loss": 0.1506,
      "mae_dtheta": 0.027393648400902748,
      "mae_dx": 0.009575994685292244,
      "mae_dy": 0.0029693201649934053,
      "pose_mae_dtheta": 0.21291641891002655,
      "pose_mae_dx": 0.06162719056010246,
      "pose_mae_dy": 0.037874914705753326,
      "pose_rmse_dtheta": 0.5015900731086731,
      "pose_rmse_dx": 0.1700354814529419,
      "pose_rmse_dy": 0.12630824744701385,
      "pose_rmse_mean": 0.2659779489040375,
      "rmse_dtheta": 0.051095545291900635,
      "rmse_dx": 0.022741055116057396,
      "rmse_dy": 0.006556876003742218,
      "rmse_mean": 0.0267978273332119,
      "rotation_flip": 0.012552301399409771,
      "sparse_tokens": 8222.0,
      "step": 7903,
      "turn_loss": 0.2116338610649109,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.3672179892213343,
      "grad_norm": 0.9237092137336731,
      "learning_rate": 2.6584814872609614e-06,
      "loss": 0.3325,
      "mae_dtheta": 0.03558393940329552,
      "mae_dx": 0.012378619983792305,
      "mae_dy": 0.006348214577883482,
      "pose_mae_dtheta": 0.27052122354507446,
      "pose_mae_dx": 0.0925452932715416,
      "pose_mae_dy": 0.08583944290876389,
      "pose_rmse_dtheta": 0.5173090100288391,
      "pose_rmse_dx": 0.20975744724273682,
      "pose_rmse_dy": 0.20878666639328003,
      "pose_rmse_mean": 0.31195104122161865,
      "rmse_dtheta": 0.05601522698998451,
      "rmse_dx": 0.024718869477510452,
      "rmse_dy": 0.012881902977824211,
      "rmse_mean": 0.03120533376932144,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 9967.0,
      "step": 7904,
      "turn_loss": 0.2370804250240326,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.3672644489871771,
      "grad_norm": 0.7565115690231323,
      "learning_rate": 2.6573132992088534e-06,
      "loss": 0.1376,
      "mae_dtheta": 0.04249284043908119,
      "mae_dx": 0.01405900064855814,
      "mae_dy": 0.004032869823276997,
      "pose_mae_dtheta": 0.38363775610923767,
      "pose_mae_dx": 0.10458721220493317,
      "pose_mae_dy": 0.07324082404375076,
      "pose_rmse_dtheta": 0.6354644894599915,
      "pose_rmse_dx": 0.22591857612133026,
      "pose_rmse_dy": 0.18851318955421448,
      "pose_rmse_mean": 0.3499654233455658,
      "rmse_dtheta": 0.06242290139198303,
      "rmse_dx": 0.027804600074887276,
      "rmse_dy": 0.008054494857788086,
      "rmse_mean": 0.03276066482067108,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 6852.0,
      "step": 7905,
      "turn_loss": 0.27846384048461914,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.36731090875301986,
      "grad_norm": 0.46685990691185,
      "learning_rate": 2.656145274982081e-06,
      "loss": 0.098,
      "mae_dtheta": 0.010379579849541187,
      "mae_dx": 0.001877542003057897,
      "mae_dy": 0.0023643269669264555,
      "pose_mae_dtheta": 0.06849131733179092,
      "pose_mae_dx": 0.02489638514816761,
      "pose_mae_dy": 0.027557112276554108,
      "pose_rmse_dtheta": 0.14583921432495117,
      "pose_rmse_dx": 0.061971377581357956,
      "pose_rmse_dy": 0.06288392096757889,
      "pose_rmse_mean": 0.0902315080165863,
      "rmse_dtheta": 0.020898040384054184,
      "rmse_dx": 0.005919207818806171,
      "rmse_dy": 0.0054862406104803085,
      "rmse_mean": 0.010767830535769463,
      "rotation_flip": 0.006224825978279114,
      "sparse_tokens": 32121.0,
      "step": 7906,
      "turn_loss": 0.08872880786657333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3673573685188627,
      "grad_norm": 0.5099817514419556,
      "learning_rate": 2.65497741466233e-06,
      "loss": 0.096,
      "mae_dtheta": 0.006885392125695944,
      "mae_dx": 0.0012168786488473415,
      "mae_dy": 0.0011239148443564773,
      "pose_mae_dtheta": 0.04629072919487953,
      "pose_mae_dx": 0.011286130174994469,
      "pose_mae_dy": 0.012718950398266315,
      "pose_rmse_dtheta": 0.17443157732486725,
      "pose_rmse_dx": 0.030292250216007233,
      "pose_rmse_dy": 0.044780928641557693,
      "pose_rmse_mean": 0.08316825330257416,
      "rmse_dtheta": 0.02252044901251793,
      "rmse_dx": 0.0034642419777810574,
      "rmse_dy": 0.0037673169281333685,
      "rmse_mean": 0.009917336516082287,
      "rotation_flip": 0.0020356234163045883,
      "sparse_tokens": 32169.0,
      "step": 7907,
      "turn_loss": 0.05677325278520584,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.36740382828470547,
      "grad_norm": 0.4003971815109253,
      "learning_rate": 2.653809718331265e-06,
      "loss": 0.0991,
      "mae_dtheta": 0.04239703342318535,
      "mae_dx": 0.010222031734883785,
      "mae_dy": 0.006302737630903721,
      "pose_mae_dtheta": 0.34363049268722534,
      "pose_mae_dx": 0.06281296163797379,
      "pose_mae_dy": 0.07394338399171829,
      "pose_rmse_dtheta": 0.5600720643997192,
      "pose_rmse_dx": 0.12819147109985352,
      "pose_rmse_dy": 0.19790160655975342,
      "pose_rmse_mean": 0.295388400554657,
      "rmse_dtheta": 0.059339750558137894,
      "rmse_dx": 0.02031116746366024,
      "rmse_dy": 0.014613401144742966,
      "rmse_mean": 0.03142143785953522,
      "rotation_flip": 0.016172505915164948,
      "sparse_tokens": 6045.0,
      "step": 7908,
      "turn_loss": 0.3523719906806946,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 18507.0,
      "epoch": 0.36745028805054825,
      "grad_norm": 0.7811838984489441,
      "learning_rate": 2.6526421860705474e-06,
      "loss": 0.1746,
      "mae_dtheta": 0.026646867394447327,
      "mae_dx": 0.012631758116185665,
      "mae_dy": 0.006514808163046837,
      "pose_mae_dtheta": 0.20114994049072266,
      "pose_mae_dx": 0.09311463683843613,
      "pose_mae_dy": 0.0795324370265007,
      "pose_rmse_dtheta": 0.36581912636756897,
      "pose_rmse_dx": 0.2257956564426422,
      "pose_rmse_dy": 0.18761330842971802,
      "pose_rmse_mean": 0.25974270701408386,
      "rmse_dtheta": 0.0427725575864315,
      "rmse_dx": 0.026419926434755325,
      "rmse_dy": 0.0134247075766325,
      "rmse_mean": 0.02753906510770321,
      "rotation_flip": 0.010088272392749786,
      "sparse_tokens": 15493.0,
      "step": 7909,
      "turn_loss": 0.23912157118320465,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.367496747816391,
      "grad_norm": 0.4624677896499634,
      "learning_rate": 2.65147481796182e-06,
      "loss": 0.1647,
      "mae_dtheta": 0.01252844836562872,
      "mae_dx": 0.002027438720688224,
      "mae_dy": 0.0032446689438074827,
      "pose_mae_dtheta": 0.08500241488218307,
      "pose_mae_dx": 0.023301636800169945,
      "pose_mae_dy": 0.03402036800980568,
      "pose_rmse_dtheta": 0.19655141234397888,
      "pose_rmse_dx": 0.06270378828048706,
      "pose_rmse_dy": 0.07511094957590103,
      "pose_rmse_mean": 0.11145538091659546,
      "rmse_dtheta": 0.024963947013020515,
      "rmse_dx": 0.00690232589840889,
      "rmse_dy": 0.007474924903362989,
      "rmse_mean": 0.013113733381032944,
      "rotation_flip": 0.00599700165912509,
      "sparse_tokens": 32073.0,
      "step": 7910,
      "turn_loss": 0.10833548754453659,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3675432075822338,
      "grad_norm": 0.5039120316505432,
      "learning_rate": 2.650307614086721e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.007201851345598698,
      "mae_dx": 0.0013252223143354058,
      "mae_dy": 0.0019050516420975327,
      "pose_mae_dtheta": 0.04480314627289772,
      "pose_mae_dx": 0.017110396176576614,
      "pose_mae_dy": 0.01970253698527813,
      "pose_rmse_dtheta": 0.09060150384902954,
      "pose_rmse_dx": 0.044089846312999725,
      "pose_rmse_dy": 0.046041250228881836,
      "pose_rmse_mean": 0.060244202613830566,
      "rmse_dtheta": 0.01495389360934496,
      "rmse_dx": 0.0034711663611233234,
      "rmse_dy": 0.0045193335972726345,
      "rmse_mean": 0.007648131810128689,
      "rotation_flip": 0.0020424837712198496,
      "sparse_tokens": 32105.0,
      "step": 7911,
      "turn_loss": 0.06224194914102554,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3675896673480766,
      "grad_norm": 0.5954182744026184,
      "learning_rate": 2.6491405745268695e-06,
      "loss": 0.1171,
      "mae_dtheta": 0.010588860139250755,
      "mae_dx": 0.0014447516296058893,
      "mae_dy": 0.0026867524720728397,
      "pose_mae_dtheta": 0.07098188996315002,
      "pose_mae_dx": 0.020740743726491928,
      "pose_mae_dy": 0.029114890843629837,
      "pose_rmse_dtheta": 0.15020151436328888,
      "pose_rmse_dx": 0.05083959177136421,
      "pose_rmse_dy": 0.06674845516681671,
      "pose_rmse_mean": 0.0892631858587265,
      "rmse_dtheta": 0.021694395691156387,
      "rmse_dx": 0.0037952193524688482,
      "rmse_dy": 0.0054475292563438416,
      "rmse_mean": 0.010312382131814957,
      "rotation_flip": 0.0081936689093709,
      "sparse_tokens": 32105.0,
      "step": 7912,
      "turn_loss": 0.09274797886610031,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.36763612711391935,
      "grad_norm": 0.5139850974082947,
      "learning_rate": 2.6479736993638814e-06,
      "loss": 0.0615,
      "mae_dtheta": 0.008779919706285,
      "mae_dx": 0.001535198767669499,
      "mae_dy": 0.0018501821905374527,
      "pose_mae_dtheta": 0.05754150450229645,
      "pose_mae_dx": 0.01765737496316433,
      "pose_mae_dy": 0.02134375087916851,
      "pose_rmse_dtheta": 0.13683979213237762,
      "pose_rmse_dx": 0.045325301587581635,
      "pose_rmse_dy": 0.04648255556821823,
      "pose_rmse_mean": 0.07621588557958603,
      "rmse_dtheta": 0.02083122916519642,
      "rmse_dx": 0.004535654094070196,
      "rmse_dy": 0.004422116093337536,
      "rmse_mean": 0.009929667226970196,
      "rotation_flip": 0.003153330646455288,
      "sparse_tokens": 32137.0,
      "step": 7913,
      "turn_loss": 0.07351178675889969,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.36768258687976213,
      "grad_norm": 1.0486595630645752,
      "learning_rate": 2.6468069886793536e-06,
      "loss": 0.2771,
      "mae_dtheta": 0.04094352573156357,
      "mae_dx": 0.011005599983036518,
      "mae_dy": 0.005930974613875151,
      "pose_mae_dtheta": 0.3308437168598175,
      "pose_mae_dx": 0.08636157214641571,
      "pose_mae_dy": 0.07115849107503891,
      "pose_rmse_dtheta": 0.5963720083236694,
      "pose_rmse_dx": 0.19843119382858276,
      "pose_rmse_dy": 0.15548576414585114,
      "pose_rmse_mean": 0.3167629837989807,
      "rmse_dtheta": 0.061139971017837524,
      "rmse_dx": 0.02321833372116089,
      "rmse_dy": 0.012364311143755913,
      "rmse_mean": 0.03224087506532669,
      "rotation_flip": 0.0214932132512331,
      "sparse_tokens": 14630.0,
      "step": 7914,
      "turn_loss": 0.3109343349933624,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.3677290466456049,
      "grad_norm": 0.6983563303947449,
      "learning_rate": 2.645640442554878e-06,
      "loss": 0.1967,
      "mae_dtheta": 0.029241269454360008,
      "mae_dx": 0.010758521035313606,
      "mae_dy": 0.004731121007353067,
      "pose_mae_dtheta": 0.19210299849510193,
      "pose_mae_dx": 0.08794239908456802,
      "pose_mae_dy": 0.06537380814552307,
      "pose_rmse_dtheta": 0.371886283159256,
      "pose_rmse_dx": 0.20812281966209412,
      "pose_rmse_dy": 0.15719819068908691,
      "pose_rmse_mean": 0.245735764503479,
      "rmse_dtheta": 0.04484577849507332,
      "rmse_dx": 0.02258802205324173,
      "rmse_dy": 0.01053161546587944,
      "rmse_mean": 0.025988474488258362,
      "rotation_flip": 0.018320610746741295,
      "sparse_tokens": 10944.0,
      "step": 7915,
      "turn_loss": 0.21013207733631134,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.3677755064114477,
      "grad_norm": 0.5111685395240784,
      "learning_rate": 2.644474061072027e-06,
      "loss": 0.0914,
      "mae_dtheta": 0.02689671330153942,
      "mae_dx": 0.00810177344828844,
      "mae_dy": 0.0025978030171245337,
      "pose_mae_dtheta": 0.227474182844162,
      "pose_mae_dx": 0.054114483296871185,
      "pose_mae_dy": 0.023546434938907623,
      "pose_rmse_dtheta": 0.43934568762779236,
      "pose_rmse_dx": 0.1621897965669632,
      "pose_rmse_dy": 0.06758902966976166,
      "pose_rmse_mean": 0.22304151952266693,
      "rmse_dtheta": 0.046501271426677704,
      "rmse_dx": 0.019883738830685616,
      "rmse_dy": 0.0055709113366901875,
      "rmse_mean": 0.023985307663679123,
      "rotation_flip": 0.006688963156193495,
      "sparse_tokens": 5070.0,
      "step": 7916,
      "turn_loss": 0.16123871505260468,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.36782196617729046,
      "grad_norm": 0.4871259927749634,
      "learning_rate": 2.6433078443123695e-06,
      "loss": 0.0547,
      "mae_dtheta": 0.009216303937137127,
      "mae_dx": 0.0014243158511817455,
      "mae_dy": 0.0019124221289530396,
      "pose_mae_dtheta": 0.0602995939552784,
      "pose_mae_dx": 0.018372349441051483,
      "pose_mae_dy": 0.022265048697590828,
      "pose_rmse_dtheta": 0.185307115316391,
      "pose_rmse_dx": 0.05372781306505203,
      "pose_rmse_dy": 0.05817572772502899,
      "pose_rmse_mean": 0.09907021373510361,
      "rmse_dtheta": 0.02360287308692932,
      "rmse_dx": 0.004445165861397982,
      "rmse_dy": 0.004763561766594648,
      "rmse_mean": 0.010937200859189034,
      "rotation_flip": 0.00615384615957737,
      "sparse_tokens": 32089.0,
      "step": 7917,
      "turn_loss": 0.06897549331188202,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.36786842594313324,
      "grad_norm": 0.6230893135070801,
      "learning_rate": 2.6421417923574624e-06,
      "loss": 0.1277,
      "mae_dtheta": 0.010355326347053051,
      "mae_dx": 0.0026330824475735426,
      "mae_dy": 0.0019368984503671527,
      "pose_mae_dtheta": 0.07543827593326569,
      "pose_mae_dx": 0.02677406556904316,
      "pose_mae_dy": 0.02562044933438301,
      "pose_rmse_dtheta": 0.1991576999425888,
      "pose_rmse_dx": 0.08065325021743774,
      "pose_rmse_dy": 0.06224251538515091,
      "pose_rmse_mean": 0.11401782929897308,
      "rmse_dtheta": 0.02445891499519348,
      "rmse_dx": 0.009201204404234886,
      "rmse_dy": 0.004788612946867943,
      "rmse_mean": 0.012816245667636395,
      "rotation_flip": 0.0032034169416874647,
      "sparse_tokens": 32057.0,
      "step": 7918,
      "turn_loss": 0.08441978693008423,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.367914885708976,
      "grad_norm": 0.39499133825302124,
      "learning_rate": 2.6409759052888416e-06,
      "loss": 0.1105,
      "mae_dtheta": 0.015828611329197884,
      "mae_dx": 0.0035681112203747034,
      "mae_dy": 0.004988602828234434,
      "pose_mae_dtheta": 0.10850966721773148,
      "pose_mae_dx": 0.034654948860406876,
      "pose_mae_dy": 0.04311041533946991,
      "pose_rmse_dtheta": 0.27122732996940613,
      "pose_rmse_dx": 0.08994483202695847,
      "pose_rmse_dy": 0.09586003422737122,
      "pose_rmse_mean": 0.15234407782554626,
      "rmse_dtheta": 0.03212175890803337,
      "rmse_dx": 0.009028264321386814,
      "rmse_dy": 0.010592399165034294,
      "rmse_mean": 0.017247473821043968,
      "rotation_flip": 0.012894906103610992,
      "sparse_tokens": 32137.0,
      "step": 7919,
      "turn_loss": 0.14209261536598206,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3679613454748188,
      "grad_norm": 0.5969669222831726,
      "learning_rate": 2.639810183188045e-06,
      "loss": 0.0814,
      "mae_dtheta": 0.008733619004487991,
      "mae_dx": 0.00174346670974046,
      "mae_dy": 0.0032100649550557137,
      "pose_mae_dtheta": 0.059971027076244354,
      "pose_mae_dx": 0.02910509519279003,
      "pose_mae_dy": 0.02999879978597164,
      "pose_rmse_dtheta": 0.11162091791629791,
      "pose_rmse_dx": 0.07042313367128372,
      "pose_rmse_dy": 0.062423933297395706,
      "pose_rmse_mean": 0.08148933202028275,
      "rmse_dtheta": 0.01668856292963028,
      "rmse_dx": 0.004579878877848387,
      "rmse_dy": 0.006919907405972481,
      "rmse_mean": 0.009396117180585861,
      "rotation_flip": 0.0010611956240609288,
      "sparse_tokens": 32089.0,
      "step": 7920,
      "turn_loss": 0.0813269391655922,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.36800780524066157,
      "grad_norm": 0.3892158269882202,
      "learning_rate": 2.6386446261365874e-06,
      "loss": 0.0838,
      "mae_dtheta": 0.009909813292324543,
      "mae_dx": 0.0016865514917299151,
      "mae_dy": 0.0017595031531527638,
      "pose_mae_dtheta": 0.05997084826231003,
      "pose_mae_dx": 0.014814507216215134,
      "pose_mae_dy": 0.0190891083329916,
      "pose_rmse_dtheta": 0.15020692348480225,
      "pose_rmse_dx": 0.036822229623794556,
      "pose_rmse_dy": 0.044848956167697906,
      "pose_rmse_mean": 0.07729270309209824,
      "rmse_dtheta": 0.022968433797359467,
      "rmse_dx": 0.005508649628609419,
      "rmse_dy": 0.0038981344550848007,
      "rmse_mean": 0.010791739448904991,
      "rotation_flip": 0.0035795639269053936,
      "sparse_tokens": 32185.0,
      "step": 7921,
      "turn_loss": 0.07275506854057312,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.36805426500650434,
      "grad_norm": 0.4203151762485504,
      "learning_rate": 2.6374792342159794e-06,
      "loss": 0.1283,
      "mae_dtheta": 0.01016666553914547,
      "mae_dx": 0.0019718213006854057,
      "mae_dy": 0.002688243519514799,
      "pose_mae_dtheta": 0.06719935685396194,
      "pose_mae_dx": 0.02356656640768051,
      "pose_mae_dy": 0.0316220186650753,
      "pose_rmse_dtheta": 0.15913702547550201,
      "pose_rmse_dx": 0.059239331632852554,
      "pose_rmse_dy": 0.07926544547080994,
      "pose_rmse_mean": 0.09921394288539886,
      "rmse_dtheta": 0.02179655246436596,
      "rmse_dx": 0.0063246916979551315,
      "rmse_dy": 0.0064993067644536495,
      "rmse_mean": 0.011540183797478676,
      "rotation_flip": 0.0034429992083460093,
      "sparse_tokens": 32073.0,
      "step": 7922,
      "turn_loss": 0.09282859414815903,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.3681007247723471,
      "grad_norm": 1.0940160751342773,
      "learning_rate": 2.6363140075077155e-06,
      "loss": 0.1693,
      "mae_dtheta": 0.02832997590303421,
      "mae_dx": 0.008336632512509823,
      "mae_dy": 0.003558114171028137,
      "pose_mae_dtheta": 0.23667864501476288,
      "pose_mae_dx": 0.05711716040968895,
      "pose_mae_dy": 0.03243662416934967,
      "pose_rmse_dtheta": 0.382291316986084,
      "pose_rmse_dx": 0.16687211394309998,
      "pose_rmse_dy": 0.08871427178382874,
      "pose_rmse_mean": 0.2126259058713913,
      "rmse_dtheta": 0.04598332569003105,
      "rmse_dx": 0.017835725098848343,
      "rmse_dy": 0.009688332676887512,
      "rmse_mean": 0.024502461776137352,
      "rotation_flip": 0.01706484705209732,
      "sparse_tokens": 4734.0,
      "step": 7923,
      "turn_loss": 0.19208091497421265,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.36814718453818995,
      "grad_norm": 0.4955168068408966,
      "learning_rate": 2.6351489460932815e-06,
      "loss": 0.0634,
      "mae_dtheta": 0.005787980277091265,
      "mae_dx": 0.001267754239961505,
      "mae_dy": 0.0006770103354938328,
      "pose_mae_dtheta": 0.04035942628979683,
      "pose_mae_dx": 0.011995467357337475,
      "pose_mae_dy": 0.009922030381858349,
      "pose_rmse_dtheta": 0.17339903116226196,
      "pose_rmse_dx": 0.027231616899371147,
      "pose_rmse_dy": 0.03242338448762894,
      "pose_rmse_mean": 0.077684685587883,
      "rmse_dtheta": 0.021190697327256203,
      "rmse_dx": 0.003670696634799242,
      "rmse_dy": 0.0017859830986708403,
      "rmse_mean": 0.008882459253072739,
      "rotation_flip": 0.0009528346708975732,
      "sparse_tokens": 32201.0,
      "step": 7924,
      "turn_loss": 0.0411173440515995,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.36819364430403273,
      "grad_norm": 0.40791037678718567,
      "learning_rate": 2.633984050054153e-06,
      "loss": 0.0873,
      "mae_dtheta": 0.008104552514851093,
      "mae_dx": 0.0014127849135547876,
      "mae_dy": 0.0023182847071439028,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.40791037678718567,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.4952850341797,
      "model/head/act_norm_mean": 116.3660432449495,
      "model/head/act_norm_min": 74.37509155273438,
      "model/head/act_over_embed": 79.9678343539905,
      "model/head/grad_frac": 0.1116311326622963,
      "model/head/grad_norm": 0.04553549736738205,
      "model/head/grad_zero_frac": 0.00020083303388673812,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.701852509469697,
      "model/head/update_ratio": 0.0007759086438454688,
      "model/head/weight_delta": 9.664326667785645,
      "model/head/weight_delta_rel": 0.1695409119129181,
      "model/head/weight_norm": 58.68667221069336,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42242494225502014,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4223453776041667,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42227697372436523,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2902396975493057,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08717069774866104,
      "model/modality_embedder.encoders.pose/grad_norm": 0.035557832568883896,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5347916666666667,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011483475100249052,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0905022621154785,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10097634047269821,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96434783935547,
      "model/modality_embedder/grad_frac": 0.08717069774866104,
      "model/modality_embedder/grad_norm": 0.035557832568883896,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5347916666666667,
      "model/modality_embedder/update_ratio": 0.0011483475100249052,
      "model/modality_embedder/weight_delta": 3.0905022621154785,
      "model/modality_embedder/weight_delta_rel": 0.10097634047269821,
      "model/modality_embedder/weight_norm": 30.96434783935547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.23991394042969,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.27796316337983,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.136767387390137,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.684043579746827,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07888797670602798,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.032179225236177444,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011522640706971288,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.585052728652954,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09420087933540344,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.92695426940918,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.81539916992188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.284103435145102,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.364628791809082,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.375472594137555,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08639483153820038,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.035241346806287766,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011860039085149765,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2778754234313965,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1135481670498848,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.714359283447266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.68395233154297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.106919893378226,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.640311241149902,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.628129129711912,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09415379166603088,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.038406308740377426,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012517592404037714,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.541980028152466,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1189330592751503,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.681865692138672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.5896987915039,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.834034792368126,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.2627592086792,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.81501865780221,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11181121319532394,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04560895264148712,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015249652788043022,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0343739986419678,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10370050370693207,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.908191680908203,
      "model/normalizer/grad_frac": 0.4179539978504181,
      "model/normalizer/grad_norm": 0.17048777639865875,
      "model/normalizer/grad_zero_frac": 0.00017489728634245694,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021692062728106976,
      "model/normalizer/weight_delta": 6.40494441986084,
      "model/normalizer/weight_delta_rel": 0.08249197900295258,
      "model/normalizer/weight_norm": 78.59454345703125,
      "pose_mae_dtheta": 0.05372365936636925,
      "pose_mae_dx": 0.01714756339788437,
      "pose_mae_dy": 0.02181139960885048,
      "pose_rmse_dtheta": 0.1527603566646576,
      "pose_rmse_dx": 0.04636865481734276,
      "pose_rmse_dy": 0.05709987133741379,
      "pose_rmse_mean": 0.08540963381528854,
      "rmse_dtheta": 0.01870003342628479,
      "rmse_dx": 0.004211626015603542,
      "rmse_dy": 0.005768921226263046,
      "rmse_mean": 0.009560193866491318,
      "rotation_flip": 0.0034602077212184668,
      "sparse_tokens": 32121.0,
      "step": 7925,
      "turn_loss": 0.06882290542125702,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.3682401040698755,
      "grad_norm": 0.9050606489181519,
      "learning_rate": 2.6328193194717875e-06,
      "loss": 0.2863,
      "mae_dtheta": 0.02818448469042778,
      "mae_dx": 0.007790786679834127,
      "mae_dy": 0.004193304106593132,
      "pose_mae_dtheta": 0.22084006667137146,
      "pose_mae_dx": 0.05790535360574722,
      "pose_mae_dy": 0.06487657129764557,
      "pose_rmse_dtheta": 0.4255681335926056,
      "pose_rmse_dx": 0.14357902109622955,
      "pose_rmse_dy": 0.17913228273391724,
      "pose_rmse_mean": 0.2494264841079712,
      "rmse_dtheta": 0.04466706141829491,
      "rmse_dx": 0.018519137054681778,
      "rmse_dy": 0.012076226994395256,
      "rmse_mean": 0.025087475776672363,
      "rotation_flip": 0.018121911212801933,
      "sparse_tokens": 11752.0,
      "step": 7926,
      "turn_loss": 0.18150901794433594,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3682865638357183,
      "grad_norm": 0.5881596207618713,
      "learning_rate": 2.63165475442764e-06,
      "loss": 0.0948,
      "mae_dtheta": 0.007676001638174057,
      "mae_dx": 0.0016065884847193956,
      "mae_dy": 0.0019206295255571604,
      "pose_mae_dtheta": 0.05771878734230995,
      "pose_mae_dx": 0.016068996861577034,
      "pose_mae_dy": 0.022036293521523476,
      "pose_rmse_dtheta": 0.1602272391319275,
      "pose_rmse_dx": 0.05768517032265663,
      "pose_rmse_dy": 0.05375891551375389,
      "pose_rmse_mean": 0.09055711328983307,
      "rmse_dtheta": 0.019173838198184967,
      "rmse_dx": 0.0066030872985720634,
      "rmse_dy": 0.006377160549163818,
      "rmse_mean": 0.010718028992414474,
      "rotation_flip": 0.0014955134829506278,
      "sparse_tokens": 32073.0,
      "step": 7927,
      "turn_loss": 0.06124263256788254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.36833302360156106,
      "grad_norm": 0.593806266784668,
      "learning_rate": 2.6304903550031445e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.013503842055797577,
      "mae_dx": 0.0012803899589926004,
      "mae_dy": 0.0027300554793328047,
      "pose_mae_dtheta": 0.09292694181203842,
      "pose_mae_dx": 0.02285892330110073,
      "pose_mae_dy": 0.039789680391550064,
      "pose_rmse_dtheta": 0.21197444200515747,
      "pose_rmse_dx": 0.06215108186006546,
      "pose_rmse_dy": 0.09331730753183365,
      "pose_rmse_mean": 0.12248094379901886,
      "rmse_dtheta": 0.026566127315163612,
      "rmse_dx": 0.004033089615404606,
      "rmse_dy": 0.005862880498170853,
      "rmse_mean": 0.012154033407568932,
      "rotation_flip": 0.009150804951786995,
      "sparse_tokens": 32057.0,
      "step": 7928,
      "turn_loss": 0.10439826548099518,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.36837948336740384,
      "grad_norm": 0.37466198205947876,
      "learning_rate": 2.6293261212797307e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.02908281795680523,
      "mae_dx": 0.011211344972252846,
      "mae_dy": 0.0063189067877829075,
      "pose_mae_dtheta": 0.2192811667919159,
      "pose_mae_dx": 0.09196124225854874,
      "pose_mae_dy": 0.0648980662226677,
      "pose_rmse_dtheta": 0.3970130681991577,
      "pose_rmse_dx": 0.1963047981262207,
      "pose_rmse_dy": 0.15874172747135162,
      "pose_rmse_mean": 0.25068652629852295,
      "rmse_dtheta": 0.04565703123807907,
      "rmse_dx": 0.02263001538813114,
      "rmse_dy": 0.013018663972616196,
      "rmse_mean": 0.027101904153823853,
      "rotation_flip": 0.0117647061124444,
      "sparse_tokens": 22862.0,
      "step": 7929,
      "turn_loss": 0.2533961534500122,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.3684259431332466,
      "grad_norm": 0.6931598782539368,
      "learning_rate": 2.628162053338815e-06,
      "loss": 0.1444,
      "mae_dtheta": 0.02875032089650631,
      "mae_dx": 0.008281810209155083,
      "mae_dy": 0.0020592580549418926,
      "pose_mae_dtheta": 0.23367568850517273,
      "pose_mae_dx": 0.060461901128292084,
      "pose_mae_dy": 0.016359571367502213,
      "pose_rmse_dtheta": 0.4755144417285919,
      "pose_rmse_dx": 0.18433551490306854,
      "pose_rmse_dy": 0.03371625393629074,
      "pose_rmse_mean": 0.23118874430656433,
      "rmse_dtheta": 0.050246112048625946,
      "rmse_dx": 0.02016947790980339,
      "rmse_dy": 0.004355994053184986,
      "rmse_mean": 0.024923861026763916,
      "rotation_flip": 0.007092198356986046,
      "sparse_tokens": 5086.0,
      "step": 7930,
      "turn_loss": 0.23153603076934814,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 7493.0,
      "epoch": 0.3684724028990894,
      "grad_norm": 0.5687400698661804,
      "learning_rate": 2.626998151261798e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.04198521748185158,
      "mae_dx": 0.011830256320536137,
      "mae_dy": 0.008437530137598515,
      "pose_mae_dtheta": 0.32364949584007263,
      "pose_mae_dx": 0.09506388008594513,
      "pose_mae_dy": 0.13174040615558624,
      "pose_rmse_dtheta": 0.5055699348449707,
      "pose_rmse_dx": 0.20976674556732178,
      "pose_rmse_dy": 0.24745717644691467,
      "pose_rmse_mean": 0.3209312856197357,
      "rmse_dtheta": 0.05712509900331497,
      "rmse_dx": 0.024569382891058922,
      "rmse_dy": 0.01292852871119976,
      "rmse_mean": 0.03154100477695465,
      "rotation_flip": 0.025974025949835777,
      "sparse_tokens": 6267.0,
      "step": 7931,
      "turn_loss": 0.3357716500759125,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.36851886266493217,
      "grad_norm": 0.4089519679546356,
      "learning_rate": 2.625834415130076e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.042473193258047104,
      "mae_dx": 0.010025449097156525,
      "mae_dy": 0.005007898434996605,
      "pose_mae_dtheta": 0.35765540599823,
      "pose_mae_dx": 0.07997717708349228,
      "pose_mae_dy": 0.06084844842553139,
      "pose_rmse_dtheta": 0.5781278610229492,
      "pose_rmse_dx": 0.17124293744564056,
      "pose_rmse_dy": 0.1304875612258911,
      "pose_rmse_mean": 0.29328614473342896,
      "rmse_dtheta": 0.059368979185819626,
      "rmse_dx": 0.022700926288962364,
      "rmse_dy": 0.01006271317601204,
      "rmse_mean": 0.030710872262716293,
      "rotation_flip": 0.008955223485827446,
      "sparse_tokens": 5001.0,
      "step": 7932,
      "turn_loss": 0.3795171082019806,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.36856532243077494,
      "grad_norm": 0.5156180262565613,
      "learning_rate": 2.6246708450250256e-06,
      "loss": 0.1054,
      "mae_dtheta": 0.00970179121941328,
      "mae_dx": 0.002331608673557639,
      "mae_dy": 0.0023108660243451595,
      "pose_mae_dtheta": 0.0643962025642395,
      "pose_mae_dx": 0.020364081487059593,
      "pose_mae_dy": 0.022771021351218224,
      "pose_rmse_dtheta": 0.1572461724281311,
      "pose_rmse_dx": 0.04743224382400513,
      "pose_rmse_dy": 0.05323440581560135,
      "pose_rmse_mean": 0.085970938205719,
      "rmse_dtheta": 0.02181917615234852,
      "rmse_dx": 0.007200643420219421,
      "rmse_dy": 0.006545713637024164,
      "rmse_mean": 0.011855177581310272,
      "rotation_flip": 0.005593803711235523,
      "sparse_tokens": 32105.0,
      "step": 7933,
      "turn_loss": 0.09043602645397186,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3686117821966177,
      "grad_norm": 0.5123933553695679,
      "learning_rate": 2.6235074410280204e-06,
      "loss": 0.115,
      "mae_dtheta": 0.01047324575483799,
      "mae_dx": 0.0010638198582455516,
      "mae_dy": 0.0020880941301584244,
      "pose_mae_dtheta": 0.0690179094672203,
      "pose_mae_dx": 0.016791528090834618,
      "pose_mae_dy": 0.024590538814663887,
      "pose_rmse_dtheta": 0.2082558572292328,
      "pose_rmse_dx": 0.04490743950009346,
      "pose_rmse_dy": 0.055670902132987976,
      "pose_rmse_mean": 0.10294473171234131,
      "rmse_dtheta": 0.023651357740163803,
      "rmse_dx": 0.00308799440972507,
      "rmse_dy": 0.004834580700844526,
      "rmse_mean": 0.010524644516408443,
      "rotation_flip": 0.0027733754832297564,
      "sparse_tokens": 32073.0,
      "step": 7934,
      "turn_loss": 0.07868096977472305,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3686582419624605,
      "grad_norm": 0.36383068561553955,
      "learning_rate": 2.6223442032204126e-06,
      "loss": 0.0809,
      "mae_dtheta": 0.007902910932898521,
      "mae_dx": 0.0011783436639234424,
      "mae_dy": 0.001279410789720714,
      "pose_mae_dtheta": 0.052405115216970444,
      "pose_mae_dx": 0.015508211217820644,
      "pose_mae_dy": 0.017092853784561157,
      "pose_rmse_dtheta": 0.19866077601909637,
      "pose_rmse_dx": 0.03861074894666672,
      "pose_rmse_dy": 0.042927034199237823,
      "pose_rmse_mean": 0.0933995172381401,
      "rmse_dtheta": 0.022434892132878304,
      "rmse_dx": 0.003506236709654331,
      "rmse_dy": 0.0029317322187125683,
      "rmse_mean": 0.009624287486076355,
      "rotation_flip": 0.0014150943607091904,
      "sparse_tokens": 32121.0,
      "step": 7935,
      "turn_loss": 0.05547089874744415,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.3687047017283033,
      "grad_norm": 0.6411895155906677,
      "learning_rate": 2.621181131683551e-06,
      "loss": 0.1285,
      "mae_dtheta": 0.03379775211215019,
      "mae_dx": 0.00879328791052103,
      "mae_dy": 0.004950030706822872,
      "pose_mae_dtheta": 0.2581847608089447,
      "pose_mae_dx": 0.0693531334400177,
      "pose_mae_dy": 0.05368185043334961,
      "pose_rmse_dtheta": 0.4716779291629791,
      "pose_rmse_dx": 0.1512679159641266,
      "pose_rmse_dy": 0.11052050441503525,
      "pose_rmse_mean": 0.24448877573013306,
      "rmse_dtheta": 0.05525434389710426,
      "rmse_dx": 0.018298493698239326,
      "rmse_dy": 0.01064486987888813,
      "rmse_mean": 0.02806590311229229,
      "rotation_flip": 0.013725490309298038,
      "sparse_tokens": 9504.0,
      "step": 7936,
      "turn_loss": 0.28910577297210693,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.36875116149414605,
      "grad_norm": 0.49909794330596924,
      "learning_rate": 2.620018226498772e-06,
      "loss": 0.1287,
      "mae_dtheta": 0.00589229678735137,
      "mae_dx": 0.001056515029631555,
      "mae_dy": 0.0011707006487995386,
      "pose_mae_dtheta": 0.0440790057182312,
      "pose_mae_dx": 0.012554568238556385,
      "pose_mae_dy": 0.018512826412916183,
      "pose_rmse_dtheta": 0.13208256661891937,
      "pose_rmse_dx": 0.035622112452983856,
      "pose_rmse_dy": 0.06684750318527222,
      "pose_rmse_mean": 0.07818406075239182,
      "rmse_dtheta": 0.015774883329868317,
      "rmse_dx": 0.0037691902834922075,
      "rmse_dy": 0.0029372000135481358,
      "rmse_mean": 0.007493758108466864,
      "rotation_flip": 0.0005518763791769743,
      "sparse_tokens": 32057.0,
      "step": 7937,
      "turn_loss": 0.04436147212982178,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.36879762125998883,
      "grad_norm": 0.43690767884254456,
      "learning_rate": 2.6188554877473944e-06,
      "loss": 0.123,
      "mae_dtheta": 0.00964075792580843,
      "mae_dx": 0.0016072381986305118,
      "mae_dy": 0.0020487648434937,
      "pose_mae_dtheta": 0.06946706026792526,
      "pose_mae_dx": 0.021318964660167694,
      "pose_mae_dy": 0.02517457865178585,
      "pose_rmse_dtheta": 0.17611417174339294,
      "pose_rmse_dx": 0.059002820402383804,
      "pose_rmse_dy": 0.05643346533179283,
      "pose_rmse_mean": 0.09718348830938339,
      "rmse_dtheta": 0.02213883399963379,
      "rmse_dx": 0.004907763097435236,
      "rmse_dy": 0.004457478411495686,
      "rmse_mean": 0.010501358658075333,
      "rotation_flip": 0.003548895940184593,
      "sparse_tokens": 32105.0,
      "step": 7938,
      "turn_loss": 0.06433844566345215,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3688440810258316,
      "grad_norm": 0.36575406789779663,
      "learning_rate": 2.617692915510732e-06,
      "loss": 0.0803,
      "mae_dtheta": 0.007091769948601723,
      "mae_dx": 0.0010377857834100723,
      "mae_dy": 0.0011204330949112773,
      "pose_mae_dtheta": 0.053405679762363434,
      "pose_mae_dx": 0.010750866495072842,
      "pose_mae_dy": 0.01730372942984104,
      "pose_rmse_dtheta": 0.2004222571849823,
      "pose_rmse_dx": 0.03203367069363594,
      "pose_rmse_dy": 0.05875268206000328,
      "pose_rmse_mean": 0.09706953167915344,
      "rmse_dtheta": 0.020985718816518784,
      "rmse_dx": 0.003650281112641096,
      "rmse_dy": 0.003359373891726136,
      "rmse_mean": 0.009331791661679745,
      "rotation_flip": 0.0016806722851470113,
      "sparse_tokens": 32073.0,
      "step": 7939,
      "turn_loss": 0.0421275869011879,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.36889054079167444,
      "grad_norm": 0.5755646228790283,
      "learning_rate": 2.6165305098700797e-06,
      "loss": 0.0887,
      "mae_dtheta": 0.03718547150492668,
      "mae_dx": 0.011225691065192223,
      "mae_dy": 0.0050513180904090405,
      "pose_mae_dtheta": 0.25813060998916626,
      "pose_mae_dx": 0.08582589030265808,
      "pose_mae_dy": 0.06835146993398666,
      "pose_rmse_dtheta": 0.41367849707603455,
      "pose_rmse_dx": 0.21105656027793884,
      "pose_rmse_dy": 0.16073846817016602,
      "pose_rmse_mean": 0.26182451844215393,
      "rmse_dtheta": 0.056733716279268265,
      "rmse_dx": 0.024757251143455505,
      "rmse_dy": 0.009005378931760788,
      "rmse_mean": 0.030165448784828186,
      "rotation_flip": 0.007936508394777775,
      "sparse_tokens": 2439.0,
      "step": 7940,
      "turn_loss": 0.27253246307373047,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.3689370005575172,
      "grad_norm": 0.4808538854122162,
      "learning_rate": 2.6153682709067317e-06,
      "loss": 0.0849,
      "mae_dtheta": 0.019882939755916595,
      "mae_dx": 0.0077538457699120045,
      "mae_dy": 0.00556976068764925,
      "pose_mae_dtheta": 0.13399235904216766,
      "pose_mae_dx": 0.06307206302881241,
      "pose_mae_dy": 0.05648181959986687,
      "pose_rmse_dtheta": 0.252551794052124,
      "pose_rmse_dx": 0.17337752878665924,
      "pose_rmse_dy": 0.13491791486740112,
      "pose_rmse_mean": 0.18694907426834106,
      "rmse_dtheta": 0.03435064107179642,
      "rmse_dx": 0.019417699426412582,
      "rmse_dy": 0.011886275373399258,
      "rmse_mean": 0.021884871646761894,
      "rotation_flip": 0.0062500000931322575,
      "sparse_tokens": 12283.0,
      "step": 7941,
      "turn_loss": 0.1666940301656723,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.36898346032336,
      "grad_norm": 0.6580573320388794,
      "learning_rate": 2.614206198701958e-06,
      "loss": 0.1058,
      "mae_dtheta": 0.01156759262084961,
      "mae_dx": 0.0012137071462348104,
      "mae_dy": 0.001532232272438705,
      "pose_mae_dtheta": 0.0830179825425148,
      "pose_mae_dx": 0.014903218485414982,
      "pose_mae_dy": 0.02051604725420475,
      "pose_rmse_dtheta": 0.279609352350235,
      "pose_rmse_dx": 0.042145293205976486,
      "pose_rmse_dy": 0.0607038214802742,
      "pose_rmse_mean": 0.12748615443706512,
      "rmse_dtheta": 0.03097587451338768,
      "rmse_dx": 0.003903841134160757,
      "rmse_dy": 0.004148067906498909,
      "rmse_mean": 0.013009260408580303,
      "rotation_flip": 0.00371944741345942,
      "sparse_tokens": 32073.0,
      "step": 7942,
      "turn_loss": 0.062252871692180634,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.36902992008920277,
      "grad_norm": 0.4411104917526245,
      "learning_rate": 2.613044293337027e-06,
      "loss": 0.1242,
      "mae_dtheta": 0.011846615932881832,
      "mae_dx": 0.0017367785330861807,
      "mae_dy": 0.0026801193598657846,
      "pose_mae_dtheta": 0.07894562929868698,
      "pose_mae_dx": 0.020849796012043953,
      "pose_mae_dy": 0.0284678116440773,
      "pose_rmse_dtheta": 0.19250763952732086,
      "pose_rmse_dx": 0.05391361936926842,
      "pose_rmse_dy": 0.0751345232129097,
      "pose_rmse_mean": 0.10718526691198349,
      "rmse_dtheta": 0.024763351306319237,
      "rmse_dx": 0.00470538716763258,
      "rmse_dy": 0.0061659617349505424,
      "rmse_mean": 0.011878233402967453,
      "rotation_flip": 0.005333333276212215,
      "sparse_tokens": 32153.0,
      "step": 7943,
      "turn_loss": 0.1009029895067215,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.36907637985504554,
      "grad_norm": 0.3842272162437439,
      "learning_rate": 2.611882554893188e-06,
      "loss": 0.1064,
      "mae_dtheta": 0.03308894485235214,
      "mae_dx": 0.008977488614618778,
      "mae_dy": 0.007972968742251396,
      "pose_mae_dtheta": 0.2615562677383423,
      "pose_mae_dx": 0.07611251622438431,
      "pose_mae_dy": 0.07241566479206085,
      "pose_rmse_dtheta": 0.485586941242218,
      "pose_rmse_dx": 0.18628540635108948,
      "pose_rmse_dy": 0.19909468293190002,
      "pose_rmse_mean": 0.29032236337661743,
      "rmse_dtheta": 0.05297034978866577,
      "rmse_dx": 0.019675664603710175,
      "rmse_dy": 0.01836477778851986,
      "rmse_mean": 0.030336931347846985,
      "rotation_flip": 0.01735357940196991,
      "sparse_tokens": 9016.0,
      "step": 7944,
      "turn_loss": 0.2426484078168869,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3691228396208883,
      "grad_norm": 0.5058802366256714,
      "learning_rate": 2.6107209834516857e-06,
      "loss": 0.1258,
      "mae_dtheta": 0.010009263642132282,
      "mae_dx": 0.0022562346421182156,
      "mae_dy": 0.0025028749369084835,
      "pose_mae_dtheta": 0.06613191217184067,
      "pose_mae_dx": 0.018989644944667816,
      "pose_mae_dy": 0.02250385470688343,
      "pose_rmse_dtheta": 0.1812000870704651,
      "pose_rmse_dx": 0.055696845054626465,
      "pose_rmse_dy": 0.0529509112238884,
      "pose_rmse_mean": 0.09661595523357391,
      "rmse_dtheta": 0.02384316734969616,
      "rmse_dx": 0.008309854194521904,
      "rmse_dy": 0.006706597283482552,
      "rmse_mean": 0.012953206896781921,
      "rotation_flip": 0.004537953995168209,
      "sparse_tokens": 32121.0,
      "step": 7945,
      "turn_loss": 0.09459532052278519,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3691692993867311,
      "grad_norm": 0.3929772973060608,
      "learning_rate": 2.609559579093745e-06,
      "loss": 0.0748,
      "mae_dtheta": 0.007264248561114073,
      "mae_dx": 0.0015108563238754869,
      "mae_dy": 0.0009470587247051299,
      "pose_mae_dtheta": 0.055390339344739914,
      "pose_mae_dx": 0.011399597860872746,
      "pose_mae_dy": 0.01240493543446064,
      "pose_rmse_dtheta": 0.19554215669631958,
      "pose_rmse_dx": 0.0298641175031662,
      "pose_rmse_dy": 0.041414372622966766,
      "pose_rmse_mean": 0.08894021809101105,
      "rmse_dtheta": 0.024075308814644814,
      "rmse_dx": 0.0050566657446324825,
      "rmse_dy": 0.004062139894813299,
      "rmse_mean": 0.01106470450758934,
      "rotation_flip": 0.004060913808643818,
      "sparse_tokens": 32201.0,
      "step": 7946,
      "turn_loss": 0.051725540310144424,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30818.0,
      "epoch": 0.3692157591525739,
      "grad_norm": 0.37205952405929565,
      "learning_rate": 2.608398341900589e-06,
      "loss": 0.1154,
      "mae_dtheta": 0.029656529426574707,
      "mae_dx": 0.007298965007066727,
      "mae_dy": 0.006551731843501329,
      "pose_mae_dtheta": 0.2242615669965744,
      "pose_mae_dx": 0.06690987199544907,
      "pose_mae_dy": 0.06779590994119644,
      "pose_rmse_dtheta": 0.3899171054363251,
      "pose_rmse_dx": 0.1425991654396057,
      "pose_rmse_dy": 0.1530267298221588,
      "pose_rmse_mean": 0.22851431369781494,
      "rmse_dtheta": 0.0453827902674675,
      "rmse_dx": 0.01668914407491684,
      "rmse_dy": 0.011899271979928017,
      "rmse_mean": 0.02465706877410412,
      "rotation_flip": 0.016756031662225723,
      "sparse_tokens": 24466.0,
      "step": 7947,
      "turn_loss": 0.26604095101356506,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.36926221891841665,
      "grad_norm": 0.43374693393707275,
      "learning_rate": 2.6072372719534173e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.011250670067965984,
      "mae_dx": 0.0020614145323634148,
      "mae_dy": 0.0034777445252984762,
      "pose_mae_dtheta": 0.07855771481990814,
      "pose_mae_dx": 0.030965227633714676,
      "pose_mae_dy": 0.04142520949244499,
      "pose_rmse_dtheta": 0.18398502469062805,
      "pose_rmse_dx": 0.09257557988166809,
      "pose_rmse_dy": 0.13221648335456848,
      "pose_rmse_mean": 0.1362590342760086,
      "rmse_dtheta": 0.02311379462480545,
      "rmse_dx": 0.005734386388212442,
      "rmse_dy": 0.00902947410941124,
      "rmse_mean": 0.012625886127352715,
      "rotation_flip": 0.004731182940304279,
      "sparse_tokens": 32057.0,
      "step": 7948,
      "turn_loss": 0.11124485731124878,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.36930867868425943,
      "grad_norm": 0.41775962710380554,
      "learning_rate": 2.60607636933343e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.008720033802092075,
      "mae_dx": 0.000964934064541012,
      "mae_dy": 0.0015918395947664976,
      "pose_mae_dtheta": 0.05791741609573364,
      "pose_mae_dx": 0.013106199912726879,
      "pose_mae_dy": 0.022741859778761864,
      "pose_rmse_dtheta": 0.169538676738739,
      "pose_rmse_dx": 0.03486354649066925,
      "pose_rmse_dy": 0.05217631533741951,
      "pose_rmse_mean": 0.08552618324756622,
      "rmse_dtheta": 0.02075297012925148,
      "rmse_dx": 0.0032215083483606577,
      "rmse_dy": 0.003436079015955329,
      "rmse_mean": 0.00913685280829668,
      "rotation_flip": 0.0033970274962484837,
      "sparse_tokens": 32073.0,
      "step": 7949,
      "turn_loss": 0.0547620952129364,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26931.0,
      "epoch": 0.3693551384501022,
      "grad_norm": 0.6127755641937256,
      "learning_rate": 2.604915634121805e-06,
      "loss": 0.1722,
      "mae_dtheta": 0.025307191535830498,
      "mae_dx": 0.00976912397891283,
      "mae_dy": 0.004925679415464401,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.612775444984436,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.28793334960938,
      "model/head/act_norm_mean": 109.3326313064759,
      "model/head/act_norm_min": 62.83772659301758,
      "model/head/act_over_embed": 75.13440782203143,
      "model/head/grad_frac": 0.1086401641368866,
      "model/head/grad_norm": 0.06657202541828156,
      "model/head/grad_zero_frac": 0.00018211398855783045,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6869940700301205,
      "model/head/update_ratio": 0.0011343398364260793,
      "model/head/weight_delta": 9.670133590698242,
      "model/head/weight_delta_rel": 0.16964279115200043,
      "model/head/weight_norm": 58.687904357910156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4224448800086975,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42238358088902067,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.422259658575058,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29026595120432214,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09627965837717056,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05899780988693237,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5377604166666666,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019053221913054585,
      "model/modality_embedder.encoders.pose/weight_delta": 3.092695474624634,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10104800015687943,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96474266052246,
      "model/modality_embedder/grad_frac": 0.09627965837717056,
      "model/modality_embedder/grad_norm": 0.05899780988693237,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5377604166666666,
      "model/modality_embedder/update_ratio": 0.0019053221913054585,
      "model/modality_embedder/weight_delta": 3.092695474624634,
      "model/modality_embedder/weight_delta_rel": 0.10104800015687943,
      "model/modality_embedder/weight_norm": 30.96474266052246,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.14866638183594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.603022207879135,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.138192176818848,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.22021783622997,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08966639637947083,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.054945364594459534,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019674471113830805,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.587564706802368,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09429241716861725,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.92723846435547,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.62124633789062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.433341998948173,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.578927993774414,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.790821370228972,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08333834260702133,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.051067691296339035,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017185781616717577,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2811503410339355,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11366160959005356,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.7150821685791,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.52587127685547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.05650578504494,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.790550231933594,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.906274720333457,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08952438086271286,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05485834181308746,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001787943416275084,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5456080436706543,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11905487626791,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.682369232177734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.30076599121094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.87866047523427,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.969636917114258,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.158476482712548,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09864266961812973,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06044580414891243,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020209888461977243,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0380654335021973,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10382665693759918,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.909025192260742,
      "model/normalizer/grad_frac": 0.4317336976528168,
      "model/normalizer/grad_norm": 0.26455581188201904,
      "model/normalizer/grad_zero_frac": 0.00018789641035255045,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003366051707416773,
      "model/normalizer/weight_delta": 6.411737442016602,
      "model/normalizer/weight_delta_rel": 0.08257946372032166,
      "model/normalizer/weight_norm": 78.59529113769531,
      "pose_mae_dtheta": 0.18592873215675354,
      "pose_mae_dx": 0.08190896362066269,
      "pose_mae_dy": 0.049521058797836304,
      "pose_rmse_dtheta": 0.33320462703704834,
      "pose_rmse_dx": 0.1930587738752365,
      "pose_rmse_dy": 0.12594659626483917,
      "pose_rmse_mean": 0.2174033373594284,
      "rmse_dtheta": 0.04143236204981804,
      "rmse_dx": 0.02203107252717018,
      "rmse_dy": 0.011226911097764969,
      "rmse_mean": 0.024896781891584396,
      "rotation_flip": 0.014443499967455864,
      "sparse_tokens": 21029.0,
      "step": 7950,
      "turn_loss": 0.2185070514678955,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.369401598215945,
      "grad_norm": 0.29702886939048767,
      "learning_rate": 2.603755066399718e-06,
      "loss": 0.0779,
      "mae_dtheta": 0.007603141479194164,
      "mae_dx": 0.0015027760528028011,
      "mae_dy": 0.0008476318907923996,
      "pose_mae_dtheta": 0.05641723424196243,
      "pose_mae_dx": 0.014554065652191639,
      "pose_mae_dy": 0.010008214972913265,
      "pose_rmse_dtheta": 0.21614935994148254,
      "pose_rmse_dx": 0.04737148433923721,
      "pose_rmse_dy": 0.03788529336452484,
      "pose_rmse_mean": 0.1004687175154686,
      "rmse_dtheta": 0.02633465640246868,
      "rmse_dx": 0.004591824486851692,
      "rmse_dy": 0.0031955474987626076,
      "rmse_mean": 0.011374009773135185,
      "rotation_flip": 0.002188183832913637,
      "sparse_tokens": 32201.0,
      "step": 7951,
      "turn_loss": 0.04967612773180008,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.36944805798178776,
      "grad_norm": 0.4355930984020233,
      "learning_rate": 2.6025946662483227e-06,
      "loss": 0.1336,
      "mae_dtheta": 0.03143302723765373,
      "mae_dx": 0.012368353083729744,
      "mae_dy": 0.0045205969363451,
      "pose_mae_dtheta": 0.24145576357841492,
      "pose_mae_dx": 0.08805397152900696,
      "pose_mae_dy": 0.05762176215648651,
      "pose_rmse_dtheta": 0.4722647964954376,
      "pose_rmse_dx": 0.21058379113674164,
      "pose_rmse_dy": 0.14961333572864532,
      "pose_rmse_mean": 0.27748730778694153,
      "rmse_dtheta": 0.05115435644984245,
      "rmse_dx": 0.025317056104540825,
      "rmse_dy": 0.009691407904028893,
      "rmse_mean": 0.02872094139456749,
      "rotation_flip": 0.012886597774922848,
      "sparse_tokens": 20677.0,
      "step": 7952,
      "turn_loss": 0.23250821232795715,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.36949451774763054,
      "grad_norm": 0.6095672845840454,
      "learning_rate": 2.601434433748771e-06,
      "loss": 0.1613,
      "mae_dtheta": 0.00990991946309805,
      "mae_dx": 0.0018062415765598416,
      "mae_dy": 0.0017668209038674831,
      "pose_mae_dtheta": 0.06893495470285416,
      "pose_mae_dx": 0.01990295760333538,
      "pose_mae_dy": 0.020716862753033638,
      "pose_rmse_dtheta": 0.18800514936447144,
      "pose_rmse_dx": 0.055515360087156296,
      "pose_rmse_dy": 0.045504380017519,
      "pose_rmse_mean": 0.09634163230657578,
      "rmse_dtheta": 0.02226916141808033,
      "rmse_dx": 0.006379112135618925,
      "rmse_dy": 0.0037884509656578302,
      "rmse_mean": 0.010812241584062576,
      "rotation_flip": 0.003197442041710019,
      "sparse_tokens": 32137.0,
      "step": 7953,
      "turn_loss": 0.08014241605997086,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25556.0,
      "epoch": 0.3695409775134733,
      "grad_norm": 0.3807124197483063,
      "learning_rate": 2.6002743689821954e-06,
      "loss": 0.096,
      "mae_dtheta": 0.03537366911768913,
      "mae_dx": 0.014941264875233173,
      "mae_dy": 0.006885018665343523,
      "pose_mae_dtheta": 0.2717762291431427,
      "pose_mae_dx": 0.1320134550333023,
      "pose_mae_dy": 0.06822320818901062,
      "pose_rmse_dtheta": 0.45314085483551025,
      "pose_rmse_dx": 0.2749108672142029,
      "pose_rmse_dy": 0.17795921862125397,
      "pose_rmse_mean": 0.3020036518573761,
      "rmse_dtheta": 0.051282647997140884,
      "rmse_dx": 0.027852023020386696,
      "rmse_dy": 0.015357289463281631,
      "rmse_mean": 0.031497322022914886,
      "rotation_flip": 0.008873114362359047,
      "sparse_tokens": 20232.0,
      "step": 7954,
      "turn_loss": 0.34733423590660095,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.3695874372793161,
      "grad_norm": 0.8475403189659119,
      "learning_rate": 2.59911447202972e-06,
      "loss": 0.2837,
      "mae_dtheta": 0.057934585958719254,
      "mae_dx": 0.016076475381851196,
      "mae_dy": 0.008485651575028896,
      "pose_mae_dtheta": 0.5171765685081482,
      "pose_mae_dx": 0.15001989901065826,
      "pose_mae_dy": 0.08878317475318909,
      "pose_rmse_dtheta": 0.8248330354690552,
      "pose_rmse_dx": 0.2913438081741333,
      "pose_rmse_dy": 0.1727520227432251,
      "pose_rmse_mean": 0.4296429753303528,
      "rmse_dtheta": 0.08043438196182251,
      "rmse_dx": 0.028642164543271065,
      "rmse_dy": 0.016828959807753563,
      "rmse_mean": 0.04196850210428238,
      "rotation_flip": 0.002695417730137706,
      "sparse_tokens": 5566.0,
      "step": 7955,
      "turn_loss": 0.497712105512619,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.36963389704515887,
      "grad_norm": 0.45308712124824524,
      "learning_rate": 2.597954742972461e-06,
      "loss": 0.1229,
      "mae_dtheta": 0.008533493615686893,
      "mae_dx": 0.0017585353925824165,
      "mae_dy": 0.0019134747562929988,
      "pose_mae_dtheta": 0.05809256434440613,
      "pose_mae_dx": 0.01706387847661972,
      "pose_mae_dy": 0.01796233095228672,
      "pose_rmse_dtheta": 0.16495035588741302,
      "pose_rmse_dx": 0.07036121189594269,
      "pose_rmse_dy": 0.04208184778690338,
      "pose_rmse_mean": 0.09246446937322617,
      "rmse_dtheta": 0.022070767357945442,
      "rmse_dx": 0.0066757602617144585,
      "rmse_dy": 0.00574900908395648,
      "rmse_mean": 0.011498512700200081,
      "rotation_flip": 0.003722084453329444,
      "sparse_tokens": 32121.0,
      "step": 7956,
      "turn_loss": 0.0703129991889,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3696803568110017,
      "grad_norm": 0.8653251528739929,
      "learning_rate": 2.5967951818915137e-06,
      "loss": 0.1937,
      "mae_dtheta": 0.013949490152299404,
      "mae_dx": 0.004196599591523409,
      "mae_dy": 0.005762768443673849,
      "pose_mae_dtheta": 0.10714437812566757,
      "pose_mae_dx": 0.052208028733730316,
      "pose_mae_dy": 0.05024617910385132,
      "pose_rmse_dtheta": 0.2478310763835907,
      "pose_rmse_dx": 0.14024914801120758,
      "pose_rmse_dy": 0.1264023631811142,
      "pose_rmse_mean": 0.17149421572685242,
      "rmse_dtheta": 0.026987798511981964,
      "rmse_dx": 0.010839315131306648,
      "rmse_dy": 0.011776652187108994,
      "rmse_mean": 0.01653458923101425,
      "rotation_flip": 0.008275405503809452,
      "sparse_tokens": 32121.0,
      "step": 7957,
      "turn_loss": 0.13838352262973785,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3697268165768445,
      "grad_norm": 0.8325872421264648,
      "learning_rate": 2.5956357888679716e-06,
      "loss": 0.1423,
      "mae_dtheta": 0.01456894725561142,
      "mae_dx": 0.0021404698491096497,
      "mae_dy": 0.0031492765992879868,
      "pose_mae_dtheta": 0.09726036339998245,
      "pose_mae_dx": 0.02953481115400791,
      "pose_mae_dy": 0.03588424250483513,
      "pose_rmse_dtheta": 0.24877144396305084,
      "pose_rmse_dx": 0.07537857443094254,
      "pose_rmse_dy": 0.08443345129489899,
      "pose_rmse_mean": 0.13619449734687805,
      "rmse_dtheta": 0.029460949823260307,
      "rmse_dx": 0.006171801593154669,
      "rmse_dy": 0.0066544231958687305,
      "rmse_mean": 0.014095725491642952,
      "rotation_flip": 0.00913241971284151,
      "sparse_tokens": 32089.0,
      "step": 7958,
      "turn_loss": 0.10603366047143936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.36977327634268725,
      "grad_norm": 0.420966774225235,
      "learning_rate": 2.5944765639829073e-06,
      "loss": 0.1066,
      "mae_dtheta": 0.04369243234395981,
      "mae_dx": 0.011362356133759022,
      "mae_dy": 0.0068113175220787525,
      "pose_mae_dtheta": 0.3921397626399994,
      "pose_mae_dx": 0.09015276283025742,
      "pose_mae_dy": 0.07170429825782776,
      "pose_rmse_dtheta": 0.6109966039657593,
      "pose_rmse_dx": 0.17354653775691986,
      "pose_rmse_dy": 0.14599011838436127,
      "pose_rmse_mean": 0.3101777732372284,
      "rmse_dtheta": 0.06238638237118721,
      "rmse_dx": 0.021803606301546097,
      "rmse_dy": 0.012380114756524563,
      "rmse_mean": 0.03219003602862358,
      "rotation_flip": 0.015209125354886055,
      "sparse_tokens": 7777.0,
      "step": 7959,
      "turn_loss": 0.4215422570705414,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.36981973610853003,
      "grad_norm": 0.3267885148525238,
      "learning_rate": 2.59331750731739e-06,
      "loss": 0.0851,
      "mae_dtheta": 0.012918737716972828,
      "mae_dx": 0.001839989796280861,
      "mae_dy": 0.002036323305219412,
      "pose_mae_dtheta": 0.09255793690681458,
      "pose_mae_dx": 0.023588191717863083,
      "pose_mae_dy": 0.024266034364700317,
      "pose_rmse_dtheta": 0.2629605829715729,
      "pose_rmse_dx": 0.06592609733343124,
      "pose_rmse_dy": 0.05919698253273964,
      "pose_rmse_mean": 0.12936122715473175,
      "rmse_dtheta": 0.030859291553497314,
      "rmse_dx": 0.005533725488930941,
      "rmse_dy": 0.005410943645983934,
      "rmse_mean": 0.013934653252363205,
      "rotation_flip": 0.004521167371422052,
      "sparse_tokens": 32105.0,
      "step": 7960,
      "turn_loss": 0.09556954354047775,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.3698661958743728,
      "grad_norm": 0.3994045555591583,
      "learning_rate": 2.5921586189524694e-06,
      "loss": 0.0751,
      "mae_dtheta": 0.0072145829908549786,
      "mae_dx": 0.001576910843141377,
      "mae_dy": 0.0002477741800248623,
      "pose_mae_dtheta": 0.05350049212574959,
      "pose_mae_dx": 0.01219041459262371,
      "pose_mae_dy": 0.0029976945370435715,
      "pose_rmse_dtheta": 0.2408706396818161,
      "pose_rmse_dx": 0.028253430500626564,
      "pose_rmse_dy": 0.005867582745850086,
      "pose_rmse_mean": 0.09166388213634491,
      "rmse_dtheta": 0.02795775793492794,
      "rmse_dx": 0.004178694449365139,
      "rmse_dy": 0.0005619919393211603,
      "rmse_mean": 0.010899482294917107,
      "rotation_flip": 0.001818181830458343,
      "sparse_tokens": 32233.0,
      "step": 7961,
      "turn_loss": 0.041168153285980225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3699126556402156,
      "grad_norm": 0.7503442764282227,
      "learning_rate": 2.5909998989691888e-06,
      "loss": 0.1619,
      "mae_dtheta": 0.01024089939892292,
      "mae_dx": 0.001964906230568886,
      "mae_dy": 0.002003556117415428,
      "pose_mae_dtheta": 0.06973317265510559,
      "pose_mae_dx": 0.024582449346780777,
      "pose_mae_dy": 0.026447156444191933,
      "pose_rmse_dtheta": 0.19016103446483612,
      "pose_rmse_dx": 0.07723817229270935,
      "pose_rmse_dy": 0.07751213014125824,
      "pose_rmse_mean": 0.11497044563293457,
      "rmse_dtheta": 0.022941244766116142,
      "rmse_dx": 0.006932973396033049,
      "rmse_dy": 0.004999222233891487,
      "rmse_mean": 0.011624480597674847,
      "rotation_flip": 0.006983849685639143,
      "sparse_tokens": 32073.0,
      "step": 7962,
      "turn_loss": 0.07616738229990005,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.36995911540605836,
      "grad_norm": 0.6674016118049622,
      "learning_rate": 2.5898413474485797e-06,
      "loss": 0.0835,
      "mae_dtheta": 0.03893876448273659,
      "mae_dx": 0.016921406611800194,
      "mae_dy": 0.007961858063936234,
      "pose_mae_dtheta": 0.29583659768104553,
      "pose_mae_dx": 0.14027385413646698,
      "pose_mae_dy": 0.08772017806768417,
      "pose_rmse_dtheta": 0.49804800748825073,
      "pose_rmse_dx": 0.27215707302093506,
      "pose_rmse_dy": 0.21369044482707977,
      "pose_rmse_mean": 0.3279651999473572,
      "rmse_dtheta": 0.05756726488471031,
      "rmse_dx": 0.029198188334703445,
      "rmse_dy": 0.016344549134373665,
      "rmse_mean": 0.034370001405477524,
      "rotation_flip": 0.024793388321995735,
      "sparse_tokens": 4173.0,
      "step": 7963,
      "turn_loss": 0.41229045391082764,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.37000557517190114,
      "grad_norm": 0.5234559178352356,
      "learning_rate": 2.588682964471657e-06,
      "loss": 0.1036,
      "mae_dtheta": 0.011013183742761612,
      "mae_dx": 0.002038965467363596,
      "mae_dy": 0.0026253173127770424,
      "pose_mae_dtheta": 0.07294903695583344,
      "pose_mae_dx": 0.02407805435359478,
      "pose_mae_dy": 0.029616914689540863,
      "pose_rmse_dtheta": 0.15716159343719482,
      "pose_rmse_dx": 0.06258708238601685,
      "pose_rmse_dy": 0.06724463403224945,
      "pose_rmse_mean": 0.09566444158554077,
      "rmse_dtheta": 0.021650774404406548,
      "rmse_dx": 0.006295474711805582,
      "rmse_dy": 0.00602572550997138,
      "rmse_mean": 0.011323991231620312,
      "rotation_flip": 0.006869125179946423,
      "sparse_tokens": 32089.0,
      "step": 7964,
      "turn_loss": 0.09936372190713882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3700520349377439,
      "grad_norm": 0.5576046109199524,
      "learning_rate": 2.5875247501194312e-06,
      "loss": 0.1068,
      "mae_dtheta": 0.011762365698814392,
      "mae_dx": 0.0022194338962435722,
      "mae_dy": 0.0024275407195091248,
      "pose_mae_dtheta": 0.07943933457136154,
      "pose_mae_dx": 0.01978342793881893,
      "pose_mae_dy": 0.02119976282119751,
      "pose_rmse_dtheta": 0.23120951652526855,
      "pose_rmse_dx": 0.062095463275909424,
      "pose_rmse_dy": 0.05518234148621559,
      "pose_rmse_mean": 0.11616244167089462,
      "rmse_dtheta": 0.02967478707432747,
      "rmse_dx": 0.006966426968574524,
      "rmse_dy": 0.007187268231064081,
      "rmse_mean": 0.014609495177865028,
      "rotation_flip": 0.006085192784667015,
      "sparse_tokens": 32169.0,
      "step": 7965,
      "turn_loss": 0.09824010729789734,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3700984947035867,
      "grad_norm": 0.5569114089012146,
      "learning_rate": 2.5863667044728924e-06,
      "loss": 0.1358,
      "mae_dtheta": 0.008291144855320454,
      "mae_dx": 0.00117784074973315,
      "mae_dy": 0.0024126688949763775,
      "pose_mae_dtheta": 0.06030627340078354,
      "pose_mae_dx": 0.021287990733981133,
      "pose_mae_dy": 0.02760402113199234,
      "pose_rmse_dtheta": 0.17122112214565277,
      "pose_rmse_dx": 0.06716634333133698,
      "pose_rmse_dy": 0.07530820369720459,
      "pose_rmse_mean": 0.10456522554159164,
      "rmse_dtheta": 0.020538339391350746,
      "rmse_dx": 0.0031306231394410133,
      "rmse_dy": 0.006479491945356131,
      "rmse_mean": 0.010049485601484776,
      "rotation_flip": 0.001784121268428862,
      "sparse_tokens": 32057.0,
      "step": 7966,
      "turn_loss": 0.06950921565294266,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.37014495446942947,
      "grad_norm": 0.6145417094230652,
      "learning_rate": 2.585208827613025e-06,
      "loss": 0.1925,
      "mae_dtheta": 0.010420182719826698,
      "mae_dx": 0.0024876678362488747,
      "mae_dy": 0.0021350253373384476,
      "pose_mae_dtheta": 0.06605900824069977,
      "pose_mae_dx": 0.026792660355567932,
      "pose_mae_dy": 0.025260400027036667,
      "pose_rmse_dtheta": 0.15031222999095917,
      "pose_rmse_dx": 0.09369494020938873,
      "pose_rmse_dy": 0.060456566512584686,
      "pose_rmse_mean": 0.10148791968822479,
      "rmse_dtheta": 0.021495698019862175,
      "rmse_dx": 0.009371801279485226,
      "rmse_dy": 0.005410793703049421,
      "rmse_mean": 0.012092764489352703,
      "rotation_flip": 0.009725905954837799,
      "sparse_tokens": 32105.0,
      "step": 7967,
      "turn_loss": 0.10374210774898529,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.37019141423527224,
      "grad_norm": 0.6056758165359497,
      "learning_rate": 2.584051119620803e-06,
      "loss": 0.1455,
      "mae_dtheta": 0.025310903787612915,
      "mae_dx": 0.01145238522440195,
      "mae_dy": 0.005516151897609234,
      "pose_mae_dtheta": 0.18978236615657806,
      "pose_mae_dx": 0.1017012968659401,
      "pose_mae_dy": 0.06955354660749435,
      "pose_rmse_dtheta": 0.32175663113594055,
      "pose_rmse_dx": 0.21439553797245026,
      "pose_rmse_dy": 0.1627286970615387,
      "pose_rmse_mean": 0.2329603135585785,
      "rmse_dtheta": 0.039600737392902374,
      "rmse_dx": 0.023430943489074707,
      "rmse_dy": 0.010532558895647526,
      "rmse_mean": 0.024521414190530777,
      "rotation_flip": 0.01642710529267788,
      "sparse_tokens": 8368.0,
      "step": 7968,
      "turn_loss": 0.22439318895339966,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.370237874001115,
      "grad_norm": 0.37569907307624817,
      "learning_rate": 2.5828935805771804e-06,
      "loss": 0.0742,
      "mae_dtheta": 0.009472470730543137,
      "mae_dx": 0.0014059731038287282,
      "mae_dy": 0.0020915919449180365,
      "pose_mae_dtheta": 0.05691664665937424,
      "pose_mae_dx": 0.018122099339962006,
      "pose_mae_dy": 0.021524578332901,
      "pose_rmse_dtheta": 0.16607169806957245,
      "pose_rmse_dx": 0.04649844765663147,
      "pose_rmse_dy": 0.05724130943417549,
      "pose_rmse_mean": 0.08993715047836304,
      "rmse_dtheta": 0.02236942946910858,
      "rmse_dx": 0.0039544301107525826,
      "rmse_dy": 0.005595480091869831,
      "rmse_mean": 0.010639779269695282,
      "rotation_flip": 0.0049923197366297245,
      "sparse_tokens": 32121.0,
      "step": 7969,
      "turn_loss": 0.07430815696716309,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.3702843337669578,
      "grad_norm": 0.9723966121673584,
      "learning_rate": 2.5817362105631092e-06,
      "loss": 0.2075,
      "mae_dtheta": 0.03537077084183693,
      "mae_dx": 0.010876210406422615,
      "mae_dy": 0.003633434884250164,
      "pose_mae_dtheta": 0.2725413739681244,
      "pose_mae_dx": 0.09231533855199814,
      "pose_mae_dy": 0.030002407729625702,
      "pose_rmse_dtheta": 0.43157699704170227,
      "pose_rmse_dx": 0.2446814477443695,
      "pose_rmse_dy": 0.06606446206569672,
      "pose_rmse_mean": 0.24744097888469696,
      "rmse_dtheta": 0.05073872581124306,
      "rmse_dx": 0.023685282096266747,
      "rmse_dy": 0.0072656418196856976,
      "rmse_mean": 0.027229882776737213,
      "rotation_flip": 0.0065146577544510365,
      "sparse_tokens": 5282.0,
      "step": 7970,
      "turn_loss": 0.24653398990631104,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3703307935328006,
      "grad_norm": 0.6332895159721375,
      "learning_rate": 2.5805790096595205e-06,
      "loss": 0.1151,
      "mae_dtheta": 0.010559183545410633,
      "mae_dx": 0.0014939162647351623,
      "mae_dy": 0.0020509904716163874,
      "pose_mae_dtheta": 0.06426968425512314,
      "pose_mae_dx": 0.019852804020047188,
      "pose_mae_dy": 0.02578272484242916,
      "pose_rmse_dtheta": 0.15065400302410126,
      "pose_rmse_dx": 0.05303864926099777,
      "pose_rmse_dy": 0.049289654940366745,
      "pose_rmse_mean": 0.08432742953300476,
      "rmse_dtheta": 0.021733682602643967,
      "rmse_dx": 0.005448362324386835,
      "rmse_dy": 0.004020444117486477,
      "rmse_mean": 0.010400829836726189,
      "rotation_flip": 0.004578405059874058,
      "sparse_tokens": 32073.0,
      "step": 7971,
      "turn_loss": 0.07802127301692963,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16887.0,
      "epoch": 0.37037725329864335,
      "grad_norm": 1.1571276187896729,
      "learning_rate": 2.5794219779473426e-06,
      "loss": 0.2311,
      "mae_dtheta": 0.03132199868559837,
      "mae_dx": 0.011320587247610092,
      "mae_dy": 0.005413204897195101,
      "pose_mae_dtheta": 0.21745851635932922,
      "pose_mae_dx": 0.09816509485244751,
      "pose_mae_dy": 0.07268611341714859,
      "pose_rmse_dtheta": 0.3828990161418915,
      "pose_rmse_dx": 0.232376828789711,
      "pose_rmse_dy": 0.16051973402500153,
      "pose_rmse_mean": 0.25859853625297546,
      "rmse_dtheta": 0.047472041100263596,
      "rmse_dx": 0.02426157332956791,
      "rmse_dy": 0.01000504195690155,
      "rmse_mean": 0.027246220037341118,
      "rotation_flip": 0.017177913337945938,
      "sparse_tokens": 14313.0,
      "step": 7972,
      "turn_loss": 0.29701870679855347,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.3704237130644862,
      "grad_norm": 0.6410561800003052,
      "learning_rate": 2.5782651155074834e-06,
      "loss": 0.137,
      "mae_dtheta": 0.03090517222881317,
      "mae_dx": 0.008924116380512714,
      "mae_dy": 0.0036436025984585285,
      "pose_mae_dtheta": 0.20702973008155823,
      "pose_mae_dx": 0.06434226036071777,
      "pose_mae_dy": 0.04629158601164818,
      "pose_rmse_dtheta": 0.3723013997077942,
      "pose_rmse_dx": 0.1748209446668625,
      "pose_rmse_dy": 0.08783373981714249,
      "pose_rmse_mean": 0.21165204048156738,
      "rmse_dtheta": 0.04322805255651474,
      "rmse_dx": 0.02159785106778145,
      "rmse_dy": 0.0068773492239415646,
      "rmse_mean": 0.023901086300611496,
      "rotation_flip": 0.020588235929608345,
      "sparse_tokens": 5808.0,
      "step": 7973,
      "turn_loss": 0.20807231962680817,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.37047017283032896,
      "grad_norm": 0.6911779642105103,
      "learning_rate": 2.577108422420844e-06,
      "loss": 0.1466,
      "mae_dtheta": 0.011103115044534206,
      "mae_dx": 0.0017010350711643696,
      "mae_dy": 0.0024858799297362566,
      "pose_mae_dtheta": 0.07611322402954102,
      "pose_mae_dx": 0.01966118812561035,
      "pose_mae_dy": 0.02958131581544876,
      "pose_rmse_dtheta": 0.2126496434211731,
      "pose_rmse_dx": 0.060678768903017044,
      "pose_rmse_dy": 0.0705142468214035,
      "pose_rmse_mean": 0.11461423337459564,
      "rmse_dtheta": 0.023697149008512497,
      "rmse_dx": 0.006988076958805323,
      "rmse_dy": 0.006026451475918293,
      "rmse_mean": 0.012237226590514183,
      "rotation_flip": 0.0037402245216071606,
      "sparse_tokens": 32105.0,
      "step": 7974,
      "turn_loss": 0.08488862961530685,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.37051663259617174,
      "grad_norm": 0.5675226449966431,
      "learning_rate": 2.5759518987683154e-06,
      "loss": 0.1709,
      "mae_dtheta": 0.03657162934541702,
      "mae_dx": 0.013833062723279,
      "mae_dy": 0.008617278188467026,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5675227046012878,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 140.10589599609375,
      "model/head/act_norm_mean": 100.59530978732639,
      "model/head/act_norm_min": 74.27566528320312,
      "model/head/act_over_embed": 69.13003867397903,
      "model/head/grad_frac": 0.11350986361503601,
      "model/head/grad_norm": 0.06441942602396011,
      "model/head/grad_zero_frac": 0.000162443146109581,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6981065538194444,
      "model/head/update_ratio": 0.001097641303204,
      "model/head/weight_delta": 9.674513816833496,
      "model/head/weight_delta_rel": 0.1697196215391159,
      "model/head/weight_norm": 58.688961029052734,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223095178604126,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4223095178604126,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4223095178604126,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2902150543976737,
      "model/modality_embedder.encoders.pose/grad_frac": 0.03646427392959595,
      "model/modality_embedder.encoders.pose/grad_norm": 0.020694304257631302,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.000668320048134774,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0933921337127686,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10107076168060303,
      "model/modality_embedder.encoders.pose/weight_norm": 30.964662551879883,
      "model/modality_embedder/grad_frac": 0.03646427392959595,
      "model/modality_embedder/grad_norm": 0.020694304257631302,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.000668320048134774,
      "model/modality_embedder/weight_delta": 3.0933921337127686,
      "model/modality_embedder/weight_delta_rel": 0.10107076168060303,
      "model/modality_embedder/weight_norm": 30.964662551879883,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.86720275878906,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.86633666776896,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.216625213623047,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.713960636107567,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09191387891769409,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05216321349143982,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018677833722904325,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5902674198150635,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09439090639352798,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.927871704101562,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.88799285888672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.673182250330687,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.76209831237793,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.26843247425134,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09908164292573929,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05623108148574829,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018922879826277494,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2840049266815186,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11376049369573593,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.71592140197754,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.39198303222656,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.292627728174605,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.09889030456543,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.381330568113118,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09763694554567337,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05541118234395981,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018059142166748643,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5489470958709717,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11916700005531311,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.683176040649414,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.3162841796875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.21344177138448,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.49885082244873,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.701331961551343,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09534532576799393,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.054110635071992874,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018091469537466764,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0416557788848877,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10394936054944992,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.909475326538086,
      "model/normalizer/grad_frac": 0.39131391048431396,
      "model/normalizer/grad_norm": 0.22207953035831451,
      "model/normalizer/grad_zero_frac": 0.0002162581222364679,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0028255784418433905,
      "model/normalizer/weight_delta": 6.418194770812988,
      "model/normalizer/weight_delta_rel": 0.08266263455152512,
      "model/normalizer/weight_norm": 78.59613037109375,
      "pose_mae_dtheta": 0.27670183777809143,
      "pose_mae_dx": 0.11610282212495804,
      "pose_mae_dy": 0.07010331004858017,
      "pose_rmse_dtheta": 0.5082105398178101,
      "pose_rmse_dx": 0.26575201749801636,
      "pose_rmse_dy": 0.16017216444015503,
      "pose_rmse_mean": 0.31137824058532715,
      "rmse_dtheta": 0.057275231927633286,
      "rmse_dx": 0.026294583454728127,
      "rmse_dy": 0.01917247846722603,
      "rmse_mean": 0.03424743562936783,
      "rotation_flip": 0.017513135448098183,
      "sparse_tokens": 9573.0,
      "step": 7975,
      "turn_loss": 0.3072572946548462,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3705630923620145,
      "grad_norm": 0.8210099339485168,
      "learning_rate": 2.574795544630769e-06,
      "loss": 0.091,
      "mae_dtheta": 0.00821040477603674,
      "mae_dx": 0.0011368135455995798,
      "mae_dy": 0.001856801682151854,
      "pose_mae_dtheta": 0.05412298068404198,
      "pose_mae_dx": 0.014226761646568775,
      "pose_mae_dy": 0.02246171608567238,
      "pose_rmse_dtheta": 0.18478552997112274,
      "pose_rmse_dx": 0.043703339993953705,
      "pose_rmse_dy": 0.06387987732887268,
      "pose_rmse_mean": 0.09745624661445618,
      "rmse_dtheta": 0.02365395613014698,
      "rmse_dx": 0.003854351583868265,
      "rmse_dy": 0.005643018521368504,
      "rmse_mean": 0.011050442233681679,
      "rotation_flip": 0.0026648901402950287,
      "sparse_tokens": 32041.0,
      "step": 7976,
      "turn_loss": 0.06702794134616852,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3706095521278573,
      "grad_norm": 0.5058333277702332,
      "learning_rate": 2.5736393600890743e-06,
      "loss": 0.1101,
      "mae_dtheta": 0.009921192191541195,
      "mae_dx": 0.00205758074298501,
      "mae_dy": 0.0019263155991211534,
      "pose_mae_dtheta": 0.0698542445898056,
      "pose_mae_dx": 0.020527370274066925,
      "pose_mae_dy": 0.024385565891861916,
      "pose_rmse_dtheta": 0.17803625762462616,
      "pose_rmse_dx": 0.059206679463386536,
      "pose_rmse_dy": 0.05292244628071785,
      "pose_rmse_mean": 0.09672179818153381,
      "rmse_dtheta": 0.022875115275382996,
      "rmse_dx": 0.006807614583522081,
      "rmse_dy": 0.005172785371541977,
      "rmse_mean": 0.011618505232036114,
      "rotation_flip": 0.0039770216681063175,
      "sparse_tokens": 32105.0,
      "step": 7977,
      "turn_loss": 0.08512743562459946,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.37065601189370007,
      "grad_norm": 0.5539516806602478,
      "learning_rate": 2.5724833452240796e-06,
      "loss": 0.1258,
      "mae_dtheta": 0.029055127874016762,
      "mae_dx": 0.011401866562664509,
      "mae_dy": 0.004854144062846899,
      "pose_mae_dtheta": 0.21669133007526398,
      "pose_mae_dx": 0.09544961899518967,
      "pose_mae_dy": 0.06677443534135818,
      "pose_rmse_dtheta": 0.4059540033340454,
      "pose_rmse_dx": 0.220454603433609,
      "pose_rmse_dy": 0.1408129632472992,
      "pose_rmse_mean": 0.25574052333831787,
      "rmse_dtheta": 0.04518634080886841,
      "rmse_dx": 0.02351655811071396,
      "rmse_dy": 0.009790581651031971,
      "rmse_mean": 0.026164494454860687,
      "rotation_flip": 0.010958904400467873,
      "sparse_tokens": 20517.0,
      "step": 7978,
      "turn_loss": 0.23341429233551025,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 44327.0,
      "epoch": 0.37070247165954284,
      "grad_norm": 1.141945719718933,
      "learning_rate": 2.571327500116629e-06,
      "loss": 0.2724,
      "mae_dtheta": 0.03320671245455742,
      "mae_dx": 0.014174291864037514,
      "mae_dy": 0.004397433716803789,
      "pose_mae_dtheta": 0.26058095693588257,
      "pose_mae_dx": 0.11294344812631607,
      "pose_mae_dy": 0.05335918813943863,
      "pose_rmse_dtheta": 0.44291952252388,
      "pose_rmse_dx": 0.24236293137073517,
      "pose_rmse_dy": 0.13222239911556244,
      "pose_rmse_mean": 0.2725016474723816,
      "rmse_dtheta": 0.049589626491069794,
      "rmse_dx": 0.026949578896164894,
      "rmse_dy": 0.009109405800700188,
      "rmse_mean": 0.02854953706264496,
      "rotation_flip": 0.009787928313016891,
      "sparse_tokens": 30227.0,
      "step": 7979,
      "turn_loss": 0.291827529668808,
      "turns": 137.0,
      "turns_per_sample": 137.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.3707489314253856,
      "grad_norm": 0.6386111378669739,
      "learning_rate": 2.570171824847548e-06,
      "loss": 0.0827,
      "mae_dtheta": 0.03037145547568798,
      "mae_dx": 0.009033284150063992,
      "mae_dy": 0.007432470563799143,
      "pose_mae_dtheta": 0.24696996808052063,
      "pose_mae_dx": 0.06731703877449036,
      "pose_mae_dy": 0.07740505784749985,
      "pose_rmse_dtheta": 0.45137521624565125,
      "pose_rmse_dx": 0.15513508021831512,
      "pose_rmse_dy": 0.20517784357070923,
      "pose_rmse_mean": 0.27056270837783813,
      "rmse_dtheta": 0.04992053285241127,
      "rmse_dx": 0.01947280578315258,
      "rmse_dy": 0.017730573192238808,
      "rmse_mean": 0.02904130332171917,
      "rotation_flip": 0.026204565539956093,
      "sparse_tokens": 19532.0,
      "step": 7980,
      "turn_loss": 0.31758418679237366,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.3707953911912284,
      "grad_norm": 0.5618560314178467,
      "learning_rate": 2.5690163194976576e-06,
      "loss": 0.0814,
      "mae_dtheta": 0.0473121702671051,
      "mae_dx": 0.007181097287684679,
      "mae_dy": 0.008059213869273663,
      "pose_mae_dtheta": 0.41905999183654785,
      "pose_mae_dx": 0.0756952315568924,
      "pose_mae_dy": 0.11174124479293823,
      "pose_rmse_dtheta": 0.6566020846366882,
      "pose_rmse_dx": 0.1762537956237793,
      "pose_rmse_dy": 0.3568829596042633,
      "pose_rmse_mean": 0.3965796232223511,
      "rmse_dtheta": 0.06562653928995132,
      "rmse_dx": 0.016468079760670662,
      "rmse_dy": 0.02050194703042507,
      "rmse_mean": 0.034198857843875885,
      "rotation_flip": 0.03846153989434242,
      "sparse_tokens": 4861.0,
      "step": 7981,
      "turn_loss": 0.28580811619758606,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.3708418509570712,
      "grad_norm": 0.6689372062683105,
      "learning_rate": 2.5678609841477585e-06,
      "loss": 0.1858,
      "mae_dtheta": 0.029797792434692383,
      "mae_dx": 0.011117888614535332,
      "mae_dy": 0.006034108344465494,
      "pose_mae_dtheta": 0.22779588401317596,
      "pose_mae_dx": 0.09043233096599579,
      "pose_mae_dy": 0.10044816881418228,
      "pose_rmse_dtheta": 0.4062795639038086,
      "pose_rmse_dx": 0.19712920486927032,
      "pose_rmse_dy": 0.20574089884757996,
      "pose_rmse_mean": 0.2697165608406067,
      "rmse_dtheta": 0.04482395574450493,
      "rmse_dx": 0.02347913570702076,
      "rmse_dy": 0.010599687695503235,
      "rmse_mean": 0.026300927624106407,
      "rotation_flip": 0.016522422432899475,
      "sparse_tokens": 22104.0,
      "step": 7982,
      "turn_loss": 0.26431936025619507,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.37088831072291395,
      "grad_norm": 0.46660974621772766,
      "learning_rate": 2.5667058188786485e-06,
      "loss": 0.1166,
      "mae_dtheta": 0.01080416887998581,
      "mae_dx": 0.0014075961662456393,
      "mae_dy": 0.0021796852815896273,
      "pose_mae_dtheta": 0.07627388089895248,
      "pose_mae_dx": 0.021486597135663033,
      "pose_mae_dy": 0.030998967587947845,
      "pose_rmse_dtheta": 0.18196138739585876,
      "pose_rmse_dx": 0.05405844375491142,
      "pose_rmse_dy": 0.07303831726312637,
      "pose_rmse_mean": 0.10301938652992249,
      "rmse_dtheta": 0.021874425932765007,
      "rmse_dx": 0.004591670352965593,
      "rmse_dy": 0.0042619165033102036,
      "rmse_mean": 0.010242670774459839,
      "rotation_flip": 0.002064409665763378,
      "sparse_tokens": 32073.0,
      "step": 7983,
      "turn_loss": 0.07295966148376465,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3709347704887567,
      "grad_norm": 0.631542444229126,
      "learning_rate": 2.5655508237711046e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.014365637674927711,
      "mae_dx": 0.002953161718323827,
      "mae_dy": 0.003132654819637537,
      "pose_mae_dtheta": 0.10203657299280167,
      "pose_mae_dx": 0.029404256492853165,
      "pose_mae_dy": 0.031359054148197174,
      "pose_rmse_dtheta": 0.291853129863739,
      "pose_rmse_dx": 0.0742281824350357,
      "pose_rmse_dy": 0.08243226259946823,
      "pose_rmse_mean": 0.14950452744960785,
      "rmse_dtheta": 0.032033685594797134,
      "rmse_dx": 0.008075389079749584,
      "rmse_dy": 0.00838426686823368,
      "rmse_mean": 0.016164448112249374,
      "rotation_flip": 0.010598031803965569,
      "sparse_tokens": 32089.0,
      "step": 7984,
      "turn_loss": 0.137490913271904,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.3709812302545995,
      "grad_norm": 0.5675424337387085,
      "learning_rate": 2.5643959989058997e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.035878024995326996,
      "mae_dx": 0.014375130645930767,
      "mae_dy": 0.004229079931974411,
      "pose_mae_dtheta": 0.28401249647140503,
      "pose_mae_dx": 0.11879352480173111,
      "pose_mae_dy": 0.06017906963825226,
      "pose_rmse_dtheta": 0.4885351359844208,
      "pose_rmse_dx": 0.24856214225292206,
      "pose_rmse_dy": 0.14873620867729187,
      "pose_rmse_mean": 0.29527783393859863,
      "rmse_dtheta": 0.05560661852359772,
      "rmse_dx": 0.028190340846776962,
      "rmse_dy": 0.009297426789999008,
      "rmse_mean": 0.031031465157866478,
      "rotation_flip": 0.011075949296355247,
      "sparse_tokens": 10731.0,
      "step": 7985,
      "turn_loss": 0.3263837993144989,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3710276900204423,
      "grad_norm": 0.39893028140068054,
      "learning_rate": 2.5632413443637887e-06,
      "loss": 0.0785,
      "mae_dtheta": 0.01112923864275217,
      "mae_dx": 0.001495861099101603,
      "mae_dy": 0.0030020717531442642,
      "pose_mae_dtheta": 0.07101921737194061,
      "pose_mae_dx": 0.02382229082286358,
      "pose_mae_dy": 0.033416908234357834,
      "pose_rmse_dtheta": 0.13297343254089355,
      "pose_rmse_dx": 0.05396094545722008,
      "pose_rmse_dy": 0.06703725457191467,
      "pose_rmse_mean": 0.0846572145819664,
      "rmse_dtheta": 0.020058173686265945,
      "rmse_dx": 0.003980991896241903,
      "rmse_dy": 0.005669543985277414,
      "rmse_mean": 0.00990290381014347,
      "rotation_flip": 0.007145177107304335,
      "sparse_tokens": 32121.0,
      "step": 7986,
      "turn_loss": 0.09073488414287567,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.37107414978628506,
      "grad_norm": 0.43242740631103516,
      "learning_rate": 2.56208686022552e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.02604248747229576,
      "mae_dx": 0.005268657114356756,
      "mae_dy": 0.005203757435083389,
      "pose_mae_dtheta": 0.18179671466350555,
      "pose_mae_dx": 0.03949126973748207,
      "pose_mae_dy": 0.057526808232069016,
      "pose_rmse_dtheta": 0.33271554112434387,
      "pose_rmse_dx": 0.0826764702796936,
      "pose_rmse_dy": 0.12974026799201965,
      "pose_rmse_mean": 0.18171076476573944,
      "rmse_dtheta": 0.04151466488838196,
      "rmse_dx": 0.01323544792830944,
      "rmse_dy": 0.010630710981786251,
      "rmse_mean": 0.021793609485030174,
      "rotation_flip": 0.00944669358432293,
      "sparse_tokens": 11875.0,
      "step": 7987,
      "turn_loss": 0.20592255890369415,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.37112060955212783,
      "grad_norm": 0.6191748976707458,
      "learning_rate": 2.560932546571824e-06,
      "loss": 0.1519,
      "mae_dtheta": 0.045325618237257004,
      "mae_dx": 0.012256195768713951,
      "mae_dy": 0.0036762182135134935,
      "pose_mae_dtheta": 0.3695930242538452,
      "pose_mae_dx": 0.09709952771663666,
      "pose_mae_dy": 0.043399013578891754,
      "pose_rmse_dtheta": 0.592729389667511,
      "pose_rmse_dx": 0.21765798330307007,
      "pose_rmse_dy": 0.10167592018842697,
      "pose_rmse_mean": 0.30402112007141113,
      "rmse_dtheta": 0.06304901838302612,
      "rmse_dx": 0.024372674524784088,
      "rmse_dy": 0.008931450545787811,
      "rmse_mean": 0.03211771696805954,
      "rotation_flip": 0.017738359048962593,
      "sparse_tokens": 13702.0,
      "step": 7988,
      "turn_loss": 0.3108108341693878,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3711670693179706,
      "grad_norm": 0.5425521731376648,
      "learning_rate": 2.5597784034834256e-06,
      "loss": 0.0851,
      "mae_dtheta": 0.009945808909833431,
      "mae_dx": 0.0017436858033761382,
      "mae_dy": 0.002270821947604418,
      "pose_mae_dtheta": 0.06833157688379288,
      "pose_mae_dx": 0.022800356149673462,
      "pose_mae_dy": 0.027076246216893196,
      "pose_rmse_dtheta": 0.18348625302314758,
      "pose_rmse_dx": 0.06689203530550003,
      "pose_rmse_dy": 0.06846319884061813,
      "pose_rmse_mean": 0.10628049820661545,
      "rmse_dtheta": 0.02272207848727703,
      "rmse_dx": 0.0054395319893956184,
      "rmse_dy": 0.005259775090962648,
      "rmse_mean": 0.011140462011098862,
      "rotation_flip": 0.004559963475912809,
      "sparse_tokens": 32073.0,
      "step": 7989,
      "turn_loss": 0.07489011436700821,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.37121352908381344,
      "grad_norm": 0.61722731590271,
      "learning_rate": 2.5586244310410313e-06,
      "loss": 0.1532,
      "mae_dtheta": 0.020320622250437737,
      "mae_dx": 0.005150188226252794,
      "mae_dy": 0.0023210870567709208,
      "pose_mae_dtheta": 0.1340808868408203,
      "pose_mae_dx": 0.04114560782909393,
      "pose_mae_dy": 0.028936253860592842,
      "pose_rmse_dtheta": 0.2666068375110626,
      "pose_rmse_dx": 0.09956669062376022,
      "pose_rmse_dy": 0.07487975060939789,
      "pose_rmse_mean": 0.14701776206493378,
      "rmse_dtheta": 0.038371969014406204,
      "rmse_dx": 0.01270347647368908,
      "rmse_dy": 0.005692324601113796,
      "rmse_mean": 0.0189225897192955,
      "rotation_flip": 0.010126582346856594,
      "sparse_tokens": 6391.0,
      "step": 7990,
      "turn_loss": 0.16429927945137024,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3712599888496562,
      "grad_norm": 0.6016275882720947,
      "learning_rate": 2.557470629325343e-06,
      "loss": 0.0934,
      "mae_dtheta": 0.009523676708340645,
      "mae_dx": 0.0016179585363715887,
      "mae_dy": 0.0024573064874857664,
      "pose_mae_dtheta": 0.06675953418016434,
      "pose_mae_dx": 0.02007417380809784,
      "pose_mae_dy": 0.026615912094712257,
      "pose_rmse_dtheta": 0.15193940699100494,
      "pose_rmse_dx": 0.05252135172486305,
      "pose_rmse_dy": 0.05582626536488533,
      "pose_rmse_mean": 0.08676233887672424,
      "rmse_dtheta": 0.020810727030038834,
      "rmse_dx": 0.00471564382314682,
      "rmse_dy": 0.005647706333547831,
      "rmse_mean": 0.010391359217464924,
      "rotation_flip": 0.004975124262273312,
      "sparse_tokens": 32089.0,
      "step": 7991,
      "turn_loss": 0.08479390293359756,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.371306448615499,
      "grad_norm": 0.4292595088481903,
      "learning_rate": 2.5563169984170426e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.00705336919054389,
      "mae_dx": 0.0013102274388074875,
      "mae_dy": 0.0011408082209527493,
      "pose_mae_dtheta": 0.04680852219462395,
      "pose_mae_dx": 0.012679503299295902,
      "pose_mae_dy": 0.011815136298537254,
      "pose_rmse_dtheta": 0.14480486512184143,
      "pose_rmse_dx": 0.0381026566028595,
      "pose_rmse_dy": 0.030536619946360588,
      "pose_rmse_mean": 0.07114805281162262,
      "rmse_dtheta": 0.019102852791547775,
      "rmse_dx": 0.004138962831348181,
      "rmse_dy": 0.003175724297761917,
      "rmse_mean": 0.00880584679543972,
      "rotation_flip": 0.0021901007276028395,
      "sparse_tokens": 32169.0,
      "step": 7992,
      "turn_loss": 0.05333395302295685,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.3713529083813418,
      "grad_norm": 0.6927151679992676,
      "learning_rate": 2.5551635383968063e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.04141146317124367,
      "mae_dx": 0.008898713625967503,
      "mae_dy": 0.0018897939007729292,
      "pose_mae_dtheta": 0.337782621383667,
      "pose_mae_dx": 0.07277927547693253,
      "pose_mae_dy": 0.019908437505364418,
      "pose_rmse_dtheta": 0.6246709227561951,
      "pose_rmse_dx": 0.1979084461927414,
      "pose_rmse_dy": 0.05589021369814873,
      "pose_rmse_mean": 0.2928231954574585,
      "rmse_dtheta": 0.06539646536111832,
      "rmse_dx": 0.020607275888323784,
      "rmse_dy": 0.004204603843390942,
      "rmse_mean": 0.030069448053836823,
      "rotation_flip": 0.018281536176800728,
      "sparse_tokens": 9183.0,
      "step": 7993,
      "turn_loss": 0.19192689657211304,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.37139936814718455,
      "grad_norm": 0.470382958650589,
      "learning_rate": 2.554010249345298e-06,
      "loss": 0.1085,
      "mae_dtheta": 0.02746373414993286,
      "mae_dx": 0.007470176089555025,
      "mae_dy": 0.005779818631708622,
      "pose_mae_dtheta": 0.1950223594903946,
      "pose_mae_dx": 0.0678807944059372,
      "pose_mae_dy": 0.0747271329164505,
      "pose_rmse_dtheta": 0.32093337178230286,
      "pose_rmse_dx": 0.14176376163959503,
      "pose_rmse_dy": 0.17312555015087128,
      "pose_rmse_mean": 0.2119409143924713,
      "rmse_dtheta": 0.04155720770359039,
      "rmse_dx": 0.0167080145329237,
      "rmse_dy": 0.009804395027458668,
      "rmse_mean": 0.022689875215291977,
      "rotation_flip": 0.004618937615305185,
      "sparse_tokens": 14456.0,
      "step": 7994,
      "turn_loss": 0.24539391696453094,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 1658.0,
      "epoch": 0.3714458279130273,
      "grad_norm": 0.47980332374572754,
      "learning_rate": 2.5528571313431637e-06,
      "loss": 0.099,
      "mae_dtheta": 0.05599258840084076,
      "mae_dx": 0.02666161209344864,
      "mae_dy": 0.029819123446941376,
      "pose_mae_dtheta": 0.29192253947257996,
      "pose_mae_dx": 0.11120940744876862,
      "pose_mae_dy": 0.2579723596572876,
      "pose_rmse_dtheta": 0.4114514887332916,
      "pose_rmse_dx": 0.1702130138874054,
      "pose_rmse_dy": 0.465670645236969,
      "pose_rmse_mean": 0.34911173582077026,
      "rmse_dtheta": 0.06977684050798416,
      "rmse_dx": 0.04538053646683693,
      "rmse_dy": 0.04095574840903282,
      "rmse_mean": 0.052037712186574936,
      "rotation_flip": 0.0,
      "sparse_tokens": 1369.0,
      "step": 7995,
      "turn_loss": 1.0315607786178589,
      "turns": 5.0,
      "turns_per_sample": 5.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3714922876788701,
      "grad_norm": 0.8764835596084595,
      "learning_rate": 2.5517041844710456e-06,
      "loss": 0.1634,
      "mae_dtheta": 0.010378409177064896,
      "mae_dx": 0.002159596187993884,
      "mae_dy": 0.0019435530994087458,
      "pose_mae_dtheta": 0.07085435837507248,
      "pose_mae_dx": 0.018941108137369156,
      "pose_mae_dy": 0.021732652559876442,
      "pose_rmse_dtheta": 0.19754990935325623,
      "pose_rmse_dx": 0.05159300938248634,
      "pose_rmse_dy": 0.047870635986328125,
      "pose_rmse_mean": 0.09900452196598053,
      "rmse_dtheta": 0.024262260645627975,
      "rmse_dx": 0.006990575231611729,
      "rmse_dy": 0.005407027900218964,
      "rmse_mean": 0.012219954282045364,
      "rotation_flip": 0.003872633446007967,
      "sparse_tokens": 32105.0,
      "step": 7996,
      "turn_loss": 0.08006762713193893,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3715387474447129,
      "grad_norm": 0.6362467408180237,
      "learning_rate": 2.550551408809566e-06,
      "loss": 0.1068,
      "mae_dtheta": 0.007778019644320011,
      "mae_dx": 0.0009841319406405091,
      "mae_dy": 0.0015026074834167957,
      "pose_mae_dtheta": 0.05022256448864937,
      "pose_mae_dx": 0.01517514418810606,
      "pose_mae_dy": 0.020604722201824188,
      "pose_rmse_dtheta": 0.14146560430526733,
      "pose_rmse_dx": 0.04150265455245972,
      "pose_rmse_dy": 0.04846245050430298,
      "pose_rmse_mean": 0.07714357227087021,
      "rmse_dtheta": 0.019350891932845116,
      "rmse_dx": 0.003381027141585946,
      "rmse_dy": 0.003228086745366454,
      "rmse_mean": 0.008653335273265839,
      "rotation_flip": 0.0032956686336547136,
      "sparse_tokens": 32057.0,
      "step": 7997,
      "turn_loss": 0.05307922884821892,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.37158520721055566,
      "grad_norm": 0.4462504982948303,
      "learning_rate": 2.5493988044393424e-06,
      "loss": 0.0722,
      "mae_dtheta": 0.006221721414476633,
      "mae_dx": 0.0010310783982276917,
      "mae_dy": 0.0019156970083713531,
      "pose_mae_dtheta": 0.04002780467271805,
      "pose_mae_dx": 0.017455318942666054,
      "pose_mae_dy": 0.021825581789016724,
      "pose_rmse_dtheta": 0.0875653401017189,
      "pose_rmse_dx": 0.04425778239965439,
      "pose_rmse_dy": 0.053045328706502914,
      "pose_rmse_mean": 0.06162282079458237,
      "rmse_dtheta": 0.01394717674702406,
      "rmse_dx": 0.0027352001052349806,
      "rmse_dy": 0.004689221736043692,
      "rmse_mean": 0.007123866584151983,
      "rotation_flip": 0.0013077593175694346,
      "sparse_tokens": 32041.0,
      "step": 7998,
      "turn_loss": 0.0505630224943161,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.37163166697639843,
      "grad_norm": 1.2628264427185059,
      "learning_rate": 2.5482463714409744e-06,
      "loss": 0.2713,
      "mae_dtheta": 0.03534521535038948,
      "mae_dx": 0.016839243471622467,
      "mae_dy": 0.004419311881065369,
      "pose_mae_dtheta": 0.2981358468532562,
      "pose_mae_dx": 0.13480933010578156,
      "pose_mae_dy": 0.047434836626052856,
      "pose_rmse_dtheta": 0.5047609210014343,
      "pose_rmse_dx": 0.24927951395511627,
      "pose_rmse_dy": 0.1212984099984169,
      "pose_rmse_mean": 0.29177963733673096,
      "rmse_dtheta": 0.05277274176478386,
      "rmse_dx": 0.028720475733280182,
      "rmse_dy": 0.008815113455057144,
      "rmse_mean": 0.030102774500846863,
      "rotation_flip": 0.030434781685471535,
      "sparse_tokens": 7541.0,
      "step": 7999,
      "turn_loss": 0.25526705384254456,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.3716781267422412,
      "grad_norm": 0.44276633858680725,
      "learning_rate": 2.547094109895054e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.03740312531590462,
      "mae_dx": 0.008182723075151443,
      "mae_dy": 0.0018174955621361732,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4427664279937744,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.24818420410156,
      "model/head/act_norm_mean": 103.15949041193181,
      "model/head/act_norm_min": 78.66300964355469,
      "model/head/act_over_embed": 70.89216760544512,
      "model/head/grad_frac": 0.1070861890912056,
      "model/head/grad_norm": 0.04741416871547699,
      "model/head/grad_zero_frac": 0.0001583186094649136,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7053888494318182,
      "model/head/update_ratio": 0.0008078758255578578,
      "model/head/weight_delta": 9.679689407348633,
      "model/head/weight_delta_rel": 0.1698104292154312,
      "model/head/weight_norm": 58.68992233276367,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.422324001789093,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.422324001789093,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.422324001789093,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2902250078890635,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08176524192094803,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03620290383696556,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011691601248458028,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0953528881073,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10113482922315598,
      "model/modality_embedder.encoders.pose/weight_norm": 30.964879989624023,
      "model/modality_embedder/grad_frac": 0.08176524192094803,
      "model/modality_embedder/grad_norm": 0.03620290383696556,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0011691601248458028,
      "model/modality_embedder/weight_delta": 3.0953528881073,
      "model/modality_embedder/weight_delta_rel": 0.10113482922315598,
      "model/modality_embedder/weight_norm": 30.964879989624023,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.29146575927734,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.01764576569264,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.147931098937988,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.817941664778814,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06549171358346939,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02899753302335739,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010382776381447911,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.592947483062744,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09448856860399246,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.928497314453125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.09431457519531,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.83480451839827,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.8187255859375,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.3795008099989,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06836860626935959,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030271323397755623,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001018654671497643,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.287229061126709,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11387218534946442,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.716964721679688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.88370513916016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.389579387626263,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.096882820129395,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.447956656164035,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06928476691246033,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03067697025835514,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000999756040982902,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.552783250808716,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11929580569267273,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.684457778930664,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.76302337646484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.1778612012987,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.731081008911133,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.67688066067785,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07003441452980042,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0310088861733675,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010367340873926878,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0449395179748535,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10406158119440079,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9101619720459,
      "model/normalizer/grad_frac": 0.2515154480934143,
      "model/normalizer/grad_norm": 0.11136259883642197,
      "model/normalizer/grad_zero_frac": 0.00019380509911570698,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001416874467395246,
      "model/normalizer/weight_delta": 6.424949645996094,
      "model/normalizer/weight_delta_rel": 0.0827496349811554,
      "model/normalizer/weight_norm": 78.59736633300781,
      "pose_mae_dtheta": 0.3227952718734741,
      "pose_mae_dx": 0.053488995879888535,
      "pose_mae_dy": 0.018287230283021927,
      "pose_rmse_dtheta": 0.5527286529541016,
      "pose_rmse_dx": 0.13968122005462646,
      "pose_rmse_dy": 0.0443868488073349,
      "pose_rmse_mean": 0.2455989122390747,
      "rmse_dtheta": 0.05680897831916809,
      "rmse_dx": 0.016967087984085083,
      "rmse_dy": 0.004550471436232328,
      "rmse_mean": 0.026108846068382263,
      "rotation_flip": 0.015432098880410194,
      "sparse_tokens": 5929.0,
      "step": 8000,
      "turn_loss": 0.22477804124355316,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "epoch": 0.3716781267422412,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30445748567581177,
      "eval_objectnav_nopose_mae_dtheta": 0.03988919034600258,
      "eval_objectnav_nopose_mae_dx": 0.013137776404619217,
      "eval_objectnav_nopose_mae_dy": 0.0049706134013831615,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3191927671432495,
      "eval_objectnav_nopose_pose_mae_dx": 0.10680989921092987,
      "eval_objectnav_nopose_pose_mae_dy": 0.055107519030570984,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.539434015750885,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2329983115196228,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13106057047843933,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30116432905197144,
      "eval_objectnav_nopose_rmse_dtheta": 0.0577261708676815,
      "eval_objectnav_nopose_rmse_dx": 0.02579699642956257,
      "eval_objectnav_nopose_rmse_dy": 0.010092969983816147,
      "eval_objectnav_nopose_rmse_mean": 0.03120538219809532,
      "eval_objectnav_nopose_rotation_flip": 0.015292299911379814,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30445748567581177,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 8000
    },
    {
      "epoch": 0.3716781267422412,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2753116190433502,
      "eval_objectnav_pose_mae_dtheta": 0.034400586038827896,
      "eval_objectnav_pose_mae_dx": 0.011176382191479206,
      "eval_objectnav_pose_mae_dy": 0.004581860266625881,
      "eval_objectnav_pose_pose_mae_dtheta": 0.25805553793907166,
      "eval_objectnav_pose_pose_mae_dx": 0.08904946595430374,
      "eval_objectnav_pose_pose_mae_dy": 0.04875432327389717,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45084241032600403,
      "eval_objectnav_pose_pose_rmse_dx": 0.20581740140914917,
      "eval_objectnav_pose_pose_rmse_dy": 0.11978746205568314,
      "eval_objectnav_pose_pose_rmse_mean": 0.2588157653808594,
      "eval_objectnav_pose_rmse_dtheta": 0.05177094042301178,
      "eval_objectnav_pose_rmse_dx": 0.023302622139453888,
      "eval_objectnav_pose_rmse_dy": 0.009597142226994038,
      "eval_objectnav_pose_rmse_mean": 0.028223570436239243,
      "eval_objectnav_pose_rotation_flip": 0.014528320170938969,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2753116190433502,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 8000
    },
    {
      "epoch": 0.3716781267422412,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09133056551218033,
      "eval_pointnav_mae_dtheta": 0.010265282355248928,
      "eval_pointnav_mae_dx": 0.0022310803178697824,
      "eval_pointnav_mae_dy": 0.0023269145749509335,
      "eval_pointnav_pose_mae_dtheta": 0.07133305817842484,
      "eval_pointnav_pose_mae_dx": 0.025057250633835793,
      "eval_pointnav_pose_mae_dy": 0.024742158129811287,
      "eval_pointnav_pose_rmse_dtheta": 0.20932430028915405,
      "eval_pointnav_pose_rmse_dx": 0.07988007366657257,
      "eval_pointnav_pose_rmse_dy": 0.07294042408466339,
      "eval_pointnav_pose_rmse_mean": 0.12071492522954941,
      "eval_pointnav_rmse_dtheta": 0.02570445090532303,
      "eval_pointnav_rmse_dx": 0.007231092546135187,
      "eval_pointnav_rmse_dy": 0.006351080723106861,
      "eval_pointnav_rmse_mean": 0.01309554185718298,
      "eval_pointnav_rotation_flip": 0.004120739176869392,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09133056551218033,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 8000
    },
    {
      "epoch": 0.3716781267422412,
      "eval_loss": 0.2236998900771141,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30445748567581177,
      "eval_objectnav_nopose_mae_dtheta": 0.03988919034600258,
      "eval_objectnav_nopose_mae_dx": 0.013137776404619217,
      "eval_objectnav_nopose_mae_dy": 0.0049706134013831615,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3191927671432495,
      "eval_objectnav_nopose_pose_mae_dx": 0.10680989921092987,
      "eval_objectnav_nopose_pose_mae_dy": 0.055107519030570984,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.539434015750885,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2329983115196228,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13106057047843933,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30116432905197144,
      "eval_objectnav_nopose_rmse_dtheta": 0.0577261708676815,
      "eval_objectnav_nopose_rmse_dx": 0.02579699642956257,
      "eval_objectnav_nopose_rmse_dy": 0.010092969983816147,
      "eval_objectnav_nopose_rmse_mean": 0.03120538219809532,
      "eval_objectnav_nopose_rotation_flip": 0.015292299911379814,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30445748567581177,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2753116190433502,
      "eval_objectnav_pose_mae_dtheta": 0.034400586038827896,
      "eval_objectnav_pose_mae_dx": 0.011176382191479206,
      "eval_objectnav_pose_mae_dy": 0.004581860266625881,
      "eval_objectnav_pose_pose_mae_dtheta": 0.25805553793907166,
      "eval_objectnav_pose_pose_mae_dx": 0.08904946595430374,
      "eval_objectnav_pose_pose_mae_dy": 0.04875432327389717,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45084241032600403,
      "eval_objectnav_pose_pose_rmse_dx": 0.20581740140914917,
      "eval_objectnav_pose_pose_rmse_dy": 0.11978746205568314,
      "eval_objectnav_pose_pose_rmse_mean": 0.2588157653808594,
      "eval_objectnav_pose_rmse_dtheta": 0.05177094042301178,
      "eval_objectnav_pose_rmse_dx": 0.023302622139453888,
      "eval_objectnav_pose_rmse_dy": 0.009597142226994038,
      "eval_objectnav_pose_rmse_mean": 0.028223570436239243,
      "eval_objectnav_pose_rotation_flip": 0.014528320170938969,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2753116190433502,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.09133056551218033,
      "eval_pointnav_mae_dtheta": 0.010265282355248928,
      "eval_pointnav_mae_dx": 0.0022310803178697824,
      "eval_pointnav_mae_dy": 0.0023269145749509335,
      "eval_pointnav_pose_mae_dtheta": 0.07133305817842484,
      "eval_pointnav_pose_mae_dx": 0.025057250633835793,
      "eval_pointnav_pose_mae_dy": 0.024742158129811287,
      "eval_pointnav_pose_rmse_dtheta": 0.20932430028915405,
      "eval_pointnav_pose_rmse_dx": 0.07988007366657257,
      "eval_pointnav_pose_rmse_dy": 0.07294042408466339,
      "eval_pointnav_pose_rmse_mean": 0.12071492522954941,
      "eval_pointnav_rmse_dtheta": 0.02570445090532303,
      "eval_pointnav_rmse_dx": 0.007231092546135187,
      "eval_pointnav_rmse_dy": 0.006351080723106861,
      "eval_pointnav_rmse_mean": 0.01309554185718298,
      "eval_pointnav_rotation_flip": 0.004120739176869392,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.09133056551218033,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 8000
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.371724586508084,
      "grad_norm": 0.7464228868484497,
      "learning_rate": 2.5459420198821604e-06,
      "loss": 0.13,
      "mae_dtheta": 0.024736031889915466,
      "mae_dx": 0.011015732772648335,
      "mae_dy": 0.0037283278070390224,
      "pose_mae_dtheta": 0.21168342232704163,
      "pose_mae_dx": 0.08695297688245773,
      "pose_mae_dy": 0.050529252737760544,
      "pose_rmse_dtheta": 0.37886130809783936,
      "pose_rmse_dx": 0.20508961379528046,
      "pose_rmse_dy": 0.12599800527095795,
      "pose_rmse_mean": 0.23664966225624084,
      "rmse_dtheta": 0.04068615287542343,
      "rmse_dx": 0.02308794856071472,
      "rmse_dy": 0.00733982864767313,
      "rmse_mean": 0.023704644292593002,
      "rotation_flip": 0.007936508394777775,
      "sparse_tokens": 11389.0,
      "step": 8001,
      "turn_loss": 0.22975394129753113,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 27254.0,
      "epoch": 0.37177104627392676,
      "grad_norm": 0.5905002951622009,
      "learning_rate": 2.544790101482857e-06,
      "loss": 0.1556,
      "mae_dtheta": 0.035889700055122375,
      "mae_dx": 0.009674099273979664,
      "mae_dy": 0.0032972360495477915,
      "pose_mae_dtheta": 0.27019962668418884,
      "pose_mae_dx": 0.08054345101118088,
      "pose_mae_dy": 0.04082314297556877,
      "pose_rmse_dtheta": 0.4949798882007599,
      "pose_rmse_dx": 0.19029425084590912,
      "pose_rmse_dy": 0.0981064960360527,
      "pose_rmse_mean": 0.26112687587738037,
      "rmse_dtheta": 0.05508292838931084,
      "rmse_dx": 0.021304277703166008,
      "rmse_dy": 0.006509586237370968,
      "rmse_mean": 0.02763226442039013,
      "rotation_flip": 0.010638297535479069,
      "sparse_tokens": 22019.0,
      "step": 8002,
      "turn_loss": 0.2629450261592865,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.37181750603976954,
      "grad_norm": 0.44588860869407654,
      "learning_rate": 2.543638354777701e-06,
      "loss": 0.091,
      "mae_dtheta": 0.008597096428275108,
      "mae_dx": 0.001857154886238277,
      "mae_dy": 0.002956890035420656,
      "pose_mae_dtheta": 0.05783633142709732,
      "pose_mae_dx": 0.02585466392338276,
      "pose_mae_dy": 0.02621886320412159,
      "pose_rmse_dtheta": 0.12033175677061081,
      "pose_rmse_dx": 0.06509669125080109,
      "pose_rmse_dy": 0.06554995477199554,
      "pose_rmse_mean": 0.08365947008132935,
      "rmse_dtheta": 0.017833195626735687,
      "rmse_dx": 0.004916052799671888,
      "rmse_dy": 0.006763662211596966,
      "rmse_mean": 0.009837637655436993,
      "rotation_flip": 0.002783300122246146,
      "sparse_tokens": 32073.0,
      "step": 8003,
      "turn_loss": 0.0867515429854393,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3718639658056123,
      "grad_norm": 0.47683173418045044,
      "learning_rate": 2.542486779847232e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.009828491136431694,
      "mae_dx": 0.0015988211380317807,
      "mae_dy": 0.0024660849012434483,
      "pose_mae_dtheta": 0.06055644527077675,
      "pose_mae_dx": 0.022105928510427475,
      "pose_mae_dy": 0.028346214443445206,
      "pose_rmse_dtheta": 0.12422992289066315,
      "pose_rmse_dx": 0.05910187214612961,
      "pose_rmse_dy": 0.06439527124166489,
      "pose_rmse_mean": 0.08257569372653961,
      "rmse_dtheta": 0.018734926357865334,
      "rmse_dx": 0.005202705040574074,
      "rmse_dy": 0.004910261835902929,
      "rmse_mean": 0.009615965187549591,
      "rotation_flip": 0.006206896621733904,
      "sparse_tokens": 32121.0,
      "step": 8004,
      "turn_loss": 0.0850774422287941,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3719104255714551,
      "grad_norm": 0.3763978183269501,
      "learning_rate": 2.5413353767719805e-06,
      "loss": 0.0618,
      "mae_dtheta": 0.008222674950957298,
      "mae_dx": 0.00219745677895844,
      "mae_dy": 0.0021094614639878273,
      "pose_mae_dtheta": 0.058623556047677994,
      "pose_mae_dx": 0.018206628039479256,
      "pose_mae_dy": 0.022875627502799034,
      "pose_rmse_dtheta": 0.14699256420135498,
      "pose_rmse_dx": 0.05069192871451378,
      "pose_rmse_dy": 0.06253933906555176,
      "pose_rmse_mean": 0.08674128353595734,
      "rmse_dtheta": 0.01847841404378414,
      "rmse_dx": 0.006607057526707649,
      "rmse_dy": 0.005535957869142294,
      "rmse_mean": 0.010207143612205982,
      "rotation_flip": 0.006286672316491604,
      "sparse_tokens": 32153.0,
      "step": 8005,
      "turn_loss": 0.07626445591449738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3719568853372979,
      "grad_norm": 0.4342062771320343,
      "learning_rate": 2.5401841456324683e-06,
      "loss": 0.0885,
      "mae_dtheta": 0.010088141076266766,
      "mae_dx": 0.0018464341992512345,
      "mae_dy": 0.002399143762886524,
      "pose_mae_dtheta": 0.06583552062511444,
      "pose_mae_dx": 0.022590789943933487,
      "pose_mae_dy": 0.025000954046845436,
      "pose_rmse_dtheta": 0.13673800230026245,
      "pose_rmse_dx": 0.04909567907452583,
      "pose_rmse_dy": 0.05333901569247246,
      "pose_rmse_mean": 0.07972423732280731,
      "rmse_dtheta": 0.01954764872789383,
      "rmse_dx": 0.004952594637870789,
      "rmse_dy": 0.00490904413163662,
      "rmse_mean": 0.00980309583246708,
      "rotation_flip": 0.0017661603633314371,
      "sparse_tokens": 32169.0,
      "step": 8006,
      "turn_loss": 0.08976507931947708,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24987.0,
      "epoch": 0.3720033451031407,
      "grad_norm": 0.7799023985862732,
      "learning_rate": 2.5390330865091974e-06,
      "loss": 0.2063,
      "mae_dtheta": 0.023597782477736473,
      "mae_dx": 0.006409930530935526,
      "mae_dy": 0.00416328152641654,
      "pose_mae_dtheta": 0.1669122576713562,
      "pose_mae_dx": 0.05196714401245117,
      "pose_mae_dy": 0.05914295092225075,
      "pose_rmse_dtheta": 0.30130401253700256,
      "pose_rmse_dx": 0.12014030665159225,
      "pose_rmse_dy": 0.12081367522478104,
      "pose_rmse_mean": 0.1807526797056198,
      "rmse_dtheta": 0.03982765972614288,
      "rmse_dx": 0.016225198283791542,
      "rmse_dy": 0.007454010657966137,
      "rmse_mean": 0.02116895467042923,
      "rotation_flip": 0.011586452834308147,
      "sparse_tokens": 21510.0,
      "step": 8007,
      "turn_loss": 0.21114633977413177,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3720498048689835,
      "grad_norm": 0.5026971697807312,
      "learning_rate": 2.5378821994826654e-06,
      "loss": 0.1091,
      "mae_dtheta": 0.011452928185462952,
      "mae_dx": 0.0016525252722203732,
      "mae_dy": 0.0025788675993680954,
      "pose_mae_dtheta": 0.08067692071199417,
      "pose_mae_dx": 0.023772194981575012,
      "pose_mae_dy": 0.03155233711004257,
      "pose_rmse_dtheta": 0.1998831033706665,
      "pose_rmse_dx": 0.0609678253531456,
      "pose_rmse_dy": 0.07299387454986572,
      "pose_rmse_mean": 0.11128160357475281,
      "rmse_dtheta": 0.024458078667521477,
      "rmse_dx": 0.005267366301268339,
      "rmse_dy": 0.0053641232661902905,
      "rmse_mean": 0.011696523055434227,
      "rotation_flip": 0.007835821248590946,
      "sparse_tokens": 32089.0,
      "step": 8008,
      "turn_loss": 0.08646702766418457,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.37209626463482626,
      "grad_norm": 0.38842666149139404,
      "learning_rate": 2.5367314846333503e-06,
      "loss": 0.0606,
      "mae_dtheta": 0.006889276672154665,
      "mae_dx": 0.0011578029952943325,
      "mae_dy": 0.0010144809493795037,
      "pose_mae_dtheta": 0.04373601824045181,
      "pose_mae_dx": 0.01060566771775484,
      "pose_mae_dy": 0.012768078595399857,
      "pose_rmse_dtheta": 0.1606416404247284,
      "pose_rmse_dx": 0.026429885998368263,
      "pose_rmse_dy": 0.03209255635738373,
      "pose_rmse_mean": 0.07305470108985901,
      "rmse_dtheta": 0.021438980475068092,
      "rmse_dx": 0.003637701505795121,
      "rmse_dy": 0.00250042206607759,
      "rmse_mean": 0.009192368015646935,
      "rotation_flip": 0.001997004495933652,
      "sparse_tokens": 32121.0,
      "step": 8009,
      "turn_loss": 0.05111590400338173,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5530.0,
      "epoch": 0.37214272440066903,
      "grad_norm": 0.41161346435546875,
      "learning_rate": 2.535580942041727e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.03596888855099678,
      "mae_dx": 0.006750160828232765,
      "mae_dy": 0.004546634387224913,
      "pose_mae_dtheta": 0.2959422767162323,
      "pose_mae_dx": 0.0543537475168705,
      "pose_mae_dy": 0.05673624575138092,
      "pose_rmse_dtheta": 0.4939667582511902,
      "pose_rmse_dx": 0.13260169327259064,
      "pose_rmse_dy": 0.12209723144769669,
      "pose_rmse_mean": 0.24955523014068604,
      "rmse_dtheta": 0.05366057902574539,
      "rmse_dx": 0.016409413889050484,
      "rmse_dy": 0.009099023416638374,
      "rmse_mean": 0.026389671489596367,
      "rotation_flip": 0.0074349441565573215,
      "sparse_tokens": 4658.0,
      "step": 8010,
      "turn_loss": 0.2164001166820526,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 34389.0,
      "epoch": 0.3721891841665118,
      "grad_norm": 0.5282074213027954,
      "learning_rate": 2.5344305717882487e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.03318842872977257,
      "mae_dx": 0.011951977387070656,
      "mae_dy": 0.005139755085110664,
      "pose_mae_dtheta": 0.26240381598472595,
      "pose_mae_dx": 0.09383135288953781,
      "pose_mae_dy": 0.06581331044435501,
      "pose_rmse_dtheta": 0.4804895520210266,
      "pose_rmse_dx": 0.21246196329593658,
      "pose_rmse_dy": 0.16836754977703094,
      "pose_rmse_mean": 0.28710636496543884,
      "rmse_dtheta": 0.0528373122215271,
      "rmse_dx": 0.024393998086452484,
      "rmse_dy": 0.01147516630589962,
      "rmse_mean": 0.029568826779723167,
      "rotation_flip": 0.014677728526294231,
      "sparse_tokens": 26106.0,
      "step": 8011,
      "turn_loss": 0.26638123393058777,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.3722356439323546,
      "grad_norm": 0.535391092300415,
      "learning_rate": 2.533280373953365e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.03121470846235752,
      "mae_dx": 0.009353446774184704,
      "mae_dy": 0.006432812660932541,
      "pose_mae_dtheta": 0.2144414782524109,
      "pose_mae_dx": 0.07967265695333481,
      "pose_mae_dy": 0.046588215976953506,
      "pose_rmse_dtheta": 0.4237287938594818,
      "pose_rmse_dx": 0.17418161034584045,
      "pose_rmse_dy": 0.12566863000392914,
      "pose_rmse_mean": 0.241193026304245,
      "rmse_dtheta": 0.050542667508125305,
      "rmse_dx": 0.019474847242236137,
      "rmse_dy": 0.016401125118136406,
      "rmse_mean": 0.028806215152144432,
      "rotation_flip": 0.013536378741264343,
      "sparse_tokens": 10324.0,
      "step": 8012,
      "turn_loss": 0.2731163501739502,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.37228210369819736,
      "grad_norm": 0.7094213962554932,
      "learning_rate": 2.5321303486175097e-06,
      "loss": 0.1491,
      "mae_dtheta": 0.011518919840455055,
      "mae_dx": 0.0018694712780416012,
      "mae_dy": 0.0033699548803269863,
      "pose_mae_dtheta": 0.07578582316637039,
      "pose_mae_dx": 0.026658231392502785,
      "pose_mae_dy": 0.03494226932525635,
      "pose_rmse_dtheta": 0.15397772192955017,
      "pose_rmse_dx": 0.06371954828500748,
      "pose_rmse_dy": 0.07530852407217026,
      "pose_rmse_mean": 0.0976686030626297,
      "rmse_dtheta": 0.02038871869444847,
      "rmse_dx": 0.005572910886257887,
      "rmse_dy": 0.00738971121609211,
      "rmse_mean": 0.011117113754153252,
      "rotation_flip": 0.006298110354691744,
      "sparse_tokens": 32073.0,
      "step": 8013,
      "turn_loss": 0.09414596110582352,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.37232856346404014,
      "grad_norm": 0.6754423975944519,
      "learning_rate": 2.530980495861102e-06,
      "loss": 0.1641,
      "mae_dtheta": 0.0310021061450243,
      "mae_dx": 0.013179080560803413,
      "mae_dy": 0.005590129643678665,
      "pose_mae_dtheta": 0.2270212471485138,
      "pose_mae_dx": 0.10477424412965775,
      "pose_mae_dy": 0.06803103536367416,
      "pose_rmse_dtheta": 0.37888792157173157,
      "pose_rmse_dx": 0.21981365978717804,
      "pose_rmse_dy": 0.14664679765701294,
      "pose_rmse_mean": 0.24844947457313538,
      "rmse_dtheta": 0.04619031399488449,
      "rmse_dx": 0.025167006999254227,
      "rmse_dy": 0.009200391359627247,
      "rmse_mean": 0.026852574199438095,
      "rotation_flip": 0.0225694440305233,
      "sparse_tokens": 8852.0,
      "step": 8014,
      "turn_loss": 0.26332977414131165,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3723750232298829,
      "grad_norm": 0.4612666964530945,
      "learning_rate": 2.5298308157645556e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.008019570261240005,
      "mae_dx": 0.0014833814930170774,
      "mae_dy": 0.0017615046817809343,
      "pose_mae_dtheta": 0.054339490830898285,
      "pose_mae_dx": 0.015513760037720203,
      "pose_mae_dy": 0.020110750570893288,
      "pose_rmse_dtheta": 0.171317920088768,
      "pose_rmse_dx": 0.0497564934194088,
      "pose_rmse_dy": 0.04778701066970825,
      "pose_rmse_mean": 0.08962047100067139,
      "rmse_dtheta": 0.021249428391456604,
      "rmse_dx": 0.004957675468176603,
      "rmse_dy": 0.004306260030716658,
      "rmse_mean": 0.010171121917665005,
      "rotation_flip": 0.005136106628924608,
      "sparse_tokens": 32057.0,
      "step": 8015,
      "turn_loss": 0.06539220362901688,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11379.0,
      "epoch": 0.3724214829957257,
      "grad_norm": 1.0926213264465332,
      "learning_rate": 2.528681308408264e-06,
      "loss": 0.1406,
      "mae_dtheta": 0.03265887126326561,
      "mae_dx": 0.0081478888168931,
      "mae_dy": 0.006656175944954157,
      "pose_mae_dtheta": 0.2097984254360199,
      "pose_mae_dx": 0.06685477495193481,
      "pose_mae_dy": 0.09520226716995239,
      "pose_rmse_dtheta": 0.3395741581916809,
      "pose_rmse_dx": 0.15260708332061768,
      "pose_rmse_dy": 0.2025221586227417,
      "pose_rmse_mean": 0.23156780004501343,
      "rmse_dtheta": 0.047352857887744904,
      "rmse_dx": 0.019194170832633972,
      "rmse_dy": 0.012390298768877983,
      "rmse_mean": 0.026312444359064102,
      "rotation_flip": 0.013035382144153118,
      "sparse_tokens": 9484.0,
      "step": 8016,
      "turn_loss": 0.30748388171195984,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.37246794276156847,
      "grad_norm": 0.4870380461215973,
      "learning_rate": 2.527531973872617e-06,
      "loss": 0.1526,
      "mae_dtheta": 0.03897286206483841,
      "mae_dx": 0.011470858007669449,
      "mae_dy": 0.0024257588665932417,
      "pose_mae_dtheta": 0.3303481340408325,
      "pose_mae_dx": 0.07829245179891586,
      "pose_mae_dy": 0.035269979387521744,
      "pose_rmse_dtheta": 0.552969217300415,
      "pose_rmse_dx": 0.21298855543136597,
      "pose_rmse_dy": 0.09208442270755768,
      "pose_rmse_mean": 0.2860140800476074,
      "rmse_dtheta": 0.05884662643074989,
      "rmse_dx": 0.02470254898071289,
      "rmse_dy": 0.005312013905495405,
      "rmse_mean": 0.029620394110679626,
      "rotation_flip": 0.007259528152644634,
      "sparse_tokens": 9652.0,
      "step": 8017,
      "turn_loss": 0.3059161603450775,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.37251440252741125,
      "grad_norm": 0.6500350832939148,
      "learning_rate": 2.5263828122379836e-06,
      "loss": 0.142,
      "mae_dtheta": 0.01899615302681923,
      "mae_dx": 0.004439225420355797,
      "mae_dy": 0.0032959168311208487,
      "pose_mae_dtheta": 0.09732358157634735,
      "pose_mae_dx": 0.034992020577192307,
      "pose_mae_dy": 0.034685321152210236,
      "pose_rmse_dtheta": 0.17426176369190216,
      "pose_rmse_dx": 0.09456616640090942,
      "pose_rmse_dy": 0.07596924155950546,
      "pose_rmse_mean": 0.11493238806724548,
      "rmse_dtheta": 0.03297736868262291,
      "rmse_dx": 0.010266377590596676,
      "rmse_dy": 0.007102964911609888,
      "rmse_mean": 0.016782239079475403,
      "rotation_flip": 0.0029761905316263437,
      "sparse_tokens": 4486.0,
      "step": 8018,
      "turn_loss": 0.19318152964115143,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.372560862293254,
      "grad_norm": 0.3953229486942291,
      "learning_rate": 2.52523382358473e-06,
      "loss": 0.0829,
      "mae_dtheta": 0.009156954474747181,
      "mae_dx": 0.0016036008019000292,
      "mae_dy": 0.0002918193640653044,
      "pose_mae_dtheta": 0.06432615220546722,
      "pose_mae_dx": 0.013038601726293564,
      "pose_mae_dy": 0.004301517736166716,
      "pose_rmse_dtheta": 0.26033106446266174,
      "pose_rmse_dx": 0.03247583284974098,
      "pose_rmse_dy": 0.011961516924202442,
      "pose_rmse_mean": 0.10158947110176086,
      "rmse_dtheta": 0.03205965831875801,
      "rmse_dx": 0.0043923878110945225,
      "rmse_dy": 0.0007637838716618717,
      "rmse_mean": 0.012405278161168098,
      "rotation_flip": 0.0005271481350064278,
      "sparse_tokens": 32265.0,
      "step": 8019,
      "turn_loss": 0.04115487262606621,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3726073220590968,
      "grad_norm": 0.49549880623817444,
      "learning_rate": 2.5240850079932016e-06,
      "loss": 0.0825,
      "mae_dtheta": 0.009877866134047508,
      "mae_dx": 0.0022460694890469313,
      "mae_dy": 0.0027421016711741686,
      "pose_mae_dtheta": 0.06200040876865387,
      "pose_mae_dx": 0.024897679686546326,
      "pose_mae_dy": 0.02735317312180996,
      "pose_rmse_dtheta": 0.1341007947921753,
      "pose_rmse_dx": 0.05654853582382202,
      "pose_rmse_dy": 0.06167638301849365,
      "pose_rmse_mean": 0.08410857617855072,
      "rmse_dtheta": 0.020513415336608887,
      "rmse_dx": 0.005439754109829664,
      "rmse_dy": 0.005625450983643532,
      "rmse_mean": 0.010526208207011223,
      "rotation_flip": 0.007407407276332378,
      "sparse_tokens": 32121.0,
      "step": 8020,
      "turn_loss": 0.11395604908466339,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3726537818249396,
      "grad_norm": 0.586272120475769,
      "learning_rate": 2.5229363655437394e-06,
      "loss": 0.0761,
      "mae_dtheta": 0.007951097562909126,
      "mae_dx": 0.0014768880791962147,
      "mae_dy": 0.0021152887493371964,
      "pose_mae_dtheta": 0.05371539294719696,
      "pose_mae_dx": 0.02063252404332161,
      "pose_mae_dy": 0.029022827744483948,
      "pose_rmse_dtheta": 0.1119261160492897,
      "pose_rmse_dx": 0.051032666116952896,
      "pose_rmse_dy": 0.07627572119235992,
      "pose_rmse_mean": 0.0797448381781578,
      "rmse_dtheta": 0.01584821194410324,
      "rmse_dx": 0.004536874126642942,
      "rmse_dy": 0.004551555495709181,
      "rmse_mean": 0.00831221416592598,
      "rotation_flip": 0.003153330646455288,
      "sparse_tokens": 32089.0,
      "step": 8021,
      "turn_loss": 0.07505930960178375,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.37270024159078236,
      "grad_norm": 0.6252766251564026,
      "learning_rate": 2.5217878963166652e-06,
      "loss": 0.1684,
      "mae_dtheta": 0.03698425367474556,
      "mae_dx": 0.012475968338549137,
      "mae_dy": 0.008159306831657887,
      "pose_mae_dtheta": 0.29098716378211975,
      "pose_mae_dx": 0.14604789018630981,
      "pose_mae_dy": 0.10724466294050217,
      "pose_rmse_dtheta": 0.45649486780166626,
      "pose_rmse_dx": 0.2801080048084259,
      "pose_rmse_dy": 0.23659703135490417,
      "pose_rmse_mean": 0.32440000772476196,
      "rmse_dtheta": 0.05423564836382866,
      "rmse_dx": 0.02601180411875248,
      "rmse_dy": 0.013246912509202957,
      "rmse_mean": 0.03116479143500328,
      "rotation_flip": 0.01550387591123581,
      "sparse_tokens": 4896.0,
      "step": 8022,
      "turn_loss": 0.29483383893966675,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3727467013566252,
      "grad_norm": 0.4168986976146698,
      "learning_rate": 2.520639600392295e-06,
      "loss": 0.1428,
      "mae_dtheta": 0.006762037053704262,
      "mae_dx": 0.0009390313643962145,
      "mae_dy": 0.0008216392598114908,
      "pose_mae_dtheta": 0.045090463012456894,
      "pose_mae_dx": 0.008851030841469765,
      "pose_mae_dy": 0.01097721979022026,
      "pose_rmse_dtheta": 0.1740207076072693,
      "pose_rmse_dx": 0.02073931321501732,
      "pose_rmse_dy": 0.026083841919898987,
      "pose_rmse_mean": 0.07361462712287903,
      "rmse_dtheta": 0.021086325868964195,
      "rmse_dx": 0.0029393837321549654,
      "rmse_dy": 0.00174137472640723,
      "rmse_mean": 0.008589028380811214,
      "rotation_flip": 0.002644103718921542,
      "sparse_tokens": 32089.0,
      "step": 8023,
      "turn_loss": 0.043493010103702545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.37279316112246796,
      "grad_norm": 0.5904859304428101,
      "learning_rate": 2.519491477850926e-06,
      "loss": 0.1328,
      "mae_dtheta": 0.023054951801896095,
      "mae_dx": 0.009095159359276295,
      "mae_dy": 0.003530966117978096,
      "pose_mae_dtheta": 0.16496191918849945,
      "pose_mae_dx": 0.07201673090457916,
      "pose_mae_dy": 0.04839407652616501,
      "pose_rmse_dtheta": 0.36258596181869507,
      "pose_rmse_dx": 0.1825723499059677,
      "pose_rmse_dy": 0.10937627404928207,
      "pose_rmse_mean": 0.21817819774150848,
      "rmse_dtheta": 0.040589816868305206,
      "rmse_dx": 0.022036874666810036,
      "rmse_dy": 0.00683573167771101,
      "rmse_mean": 0.023154139518737793,
      "rotation_flip": 0.005025125574320555,
      "sparse_tokens": 8911.0,
      "step": 8024,
      "turn_loss": 0.1402214914560318,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 23941.0,
      "epoch": 0.37283962088831074,
      "grad_norm": 0.45345184206962585,
      "learning_rate": 2.518343528772852e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.03590042144060135,
      "mae_dx": 0.009129824116826057,
      "mae_dy": 0.006476390175521374,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4534517228603363,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.49009704589844,
      "model/head/act_norm_mean": 108.20544763513513,
      "model/head/act_norm_min": 52.91049575805664,
      "model/head/act_over_embed": 74.35979665022626,
      "model/head/grad_frac": 0.10274220257997513,
      "model/head/grad_norm": 0.046588629484176636,
      "model/head/grad_zero_frac": 0.00018719033687375486,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7010135135135135,
      "model/head/update_ratio": 0.0007937957416288555,
      "model/head/weight_delta": 9.685445785522461,
      "model/head/weight_delta_rel": 0.16991141438484192,
      "model/head/weight_norm": 58.69095230102539,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223690927028656,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4223690927028656,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4223690927028656,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29025599478715586,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10089816898107529,
      "model/modality_embedder.encoders.pose/grad_norm": 0.045752447098493576,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001477557816542685,
      "model/modality_embedder.encoders.pose/weight_delta": 3.097898006439209,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10121798515319824,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96491050720215,
      "model/modality_embedder/grad_frac": 0.10089816898107529,
      "model/modality_embedder/grad_norm": 0.045752447098493576,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.001477557816542685,
      "model/modality_embedder/weight_delta": 3.097898006439209,
      "model/modality_embedder/weight_delta_rel": 0.10121798515319824,
      "model/modality_embedder/weight_norm": 30.96491050720215,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.484619140625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.42922665969541,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.272381782531738,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.100783908418556,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.057864949107170105,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02623896114528179,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009394914377480745,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.5954320430755615,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09457910805940628,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.928897857666016,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.24320983886719,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.225111271986272,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.466543197631836,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.647723265173973,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06297244131565094,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02855496108531952,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009608707623556256,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2902326583862305,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11397623270750046,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.717796325683594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.00540924072266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.838761194229946,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.738633155822754,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.756638598968415,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06711967289447784,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030435530468821526,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009918434079736471,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5566163063049316,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11942451447248459,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.685823440551758,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.9427261352539,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.725917323573572,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.98250675201416,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.0535099588874,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06931494921445847,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03143098205327988,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010508218547329307,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0479490756988525,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10416443645954132,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.910858154296875,
      "model/normalizer/grad_frac": 0.25667738914489746,
      "model/normalizer/grad_norm": 0.11639080196619034,
      "model/normalizer/grad_zero_frac": 0.00020916770154144615,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014808286214247346,
      "model/normalizer/weight_delta": 6.431303024291992,
      "model/normalizer/weight_delta_rel": 0.08283145725727081,
      "model/normalizer/weight_norm": 78.59842681884766,
      "pose_mae_dtheta": 0.2739112377166748,
      "pose_mae_dx": 0.08325418829917908,
      "pose_mae_dy": 0.08188976347446442,
      "pose_rmse_dtheta": 0.4884154498577118,
      "pose_rmse_dx": 0.1858406662940979,
      "pose_rmse_dy": 0.18341168761253357,
      "pose_rmse_mean": 0.28588926792144775,
      "rmse_dtheta": 0.05232207477092743,
      "rmse_dx": 0.020567817613482475,
      "rmse_dy": 0.011957148090004921,
      "rmse_mean": 0.028282348066568375,
      "rotation_flip": 0.011754068545997143,
      "sparse_tokens": 17872.0,
      "step": 8025,
      "turn_loss": 0.2966064214706421,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3728860806541535,
      "grad_norm": 0.44043412804603577,
      "learning_rate": 2.5171957532383453e-06,
      "loss": 0.0758,
      "mae_dtheta": 0.008704239502549171,
      "mae_dx": 0.0014582548756152391,
      "mae_dy": 0.0018448549089953303,
      "pose_mae_dtheta": 0.06278261542320251,
      "pose_mae_dx": 0.020227259024977684,
      "pose_mae_dy": 0.023924613371491432,
      "pose_rmse_dtheta": 0.17346465587615967,
      "pose_rmse_dx": 0.057733453810214996,
      "pose_rmse_dy": 0.06907081604003906,
      "pose_rmse_mean": 0.10008963942527771,
      "rmse_dtheta": 0.021891329437494278,
      "rmse_dx": 0.003761095693334937,
      "rmse_dy": 0.004848715383559465,
      "rmse_mean": 0.010167047381401062,
      "rotation_flip": 0.006990131456404924,
      "sparse_tokens": 32185.0,
      "step": 8026,
      "turn_loss": 0.06261762231588364,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3729325404199963,
      "grad_norm": 0.6464284658432007,
      "learning_rate": 2.516048151327673e-06,
      "loss": 0.1188,
      "mae_dtheta": 0.00567800784483552,
      "mae_dx": 0.0011531402124091983,
      "mae_dy": 0.0010144661646336317,
      "pose_mae_dtheta": 0.04102169722318649,
      "pose_mae_dx": 0.012088404037058353,
      "pose_mae_dy": 0.013819945976138115,
      "pose_rmse_dtheta": 0.14777949452400208,
      "pose_rmse_dx": 0.02821057289838791,
      "pose_rmse_dy": 0.033917684108018875,
      "pose_rmse_mean": 0.06996925175189972,
      "rmse_dtheta": 0.016767442226409912,
      "rmse_dx": 0.0034684897400438786,
      "rmse_dy": 0.0023551739286631346,
      "rmse_mean": 0.007530368398874998,
      "rotation_flip": 0.0020358306355774403,
      "sparse_tokens": 32185.0,
      "step": 8027,
      "turn_loss": 0.051722120493650436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.37297900018583907,
      "grad_norm": 0.6890864968299866,
      "learning_rate": 2.5149007231210855e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.03187688812613487,
      "mae_dx": 0.015613583847880363,
      "mae_dy": 0.006699841469526291,
      "pose_mae_dtheta": 0.2620069980621338,
      "pose_mae_dx": 0.1308792531490326,
      "pose_mae_dy": 0.06849472224712372,
      "pose_rmse_dtheta": 0.41669586300849915,
      "pose_rmse_dx": 0.25574952363967896,
      "pose_rmse_dy": 0.13768745958805084,
      "pose_rmse_mean": 0.2700442969799042,
      "rmse_dtheta": 0.049165669828653336,
      "rmse_dx": 0.027821140363812447,
      "rmse_dy": 0.013211878016591072,
      "rmse_mean": 0.03006622940301895,
      "rotation_flip": 0.013752455823123455,
      "sparse_tokens": 8383.0,
      "step": 8028,
      "turn_loss": 0.38009098172187805,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.37302545995168185,
      "grad_norm": 0.6823774576187134,
      "learning_rate": 2.5137534686988265e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.03051942028105259,
      "mae_dx": 0.007807854097336531,
      "mae_dy": 0.00466760341078043,
      "pose_mae_dtheta": 0.19925427436828613,
      "pose_mae_dx": 0.07370202988386154,
      "pose_mae_dy": 0.08316541463136673,
      "pose_rmse_dtheta": 0.3336613178253174,
      "pose_rmse_dx": 0.15027020871639252,
      "pose_rmse_dy": 0.1640932708978653,
      "pose_rmse_mean": 0.2160082757472992,
      "rmse_dtheta": 0.04719145596027374,
      "rmse_dx": 0.018312674015760422,
      "rmse_dy": 0.009949903003871441,
      "rmse_mean": 0.025151345878839493,
      "rotation_flip": 0.015015015378594398,
      "sparse_tokens": 5209.0,
      "step": 8029,
      "turn_loss": 0.2615258991718292,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3730719197175246,
      "grad_norm": 0.3455463945865631,
      "learning_rate": 2.512606388141119e-06,
      "loss": 0.0984,
      "mae_dtheta": 0.01164909079670906,
      "mae_dx": 0.0015981917968019843,
      "mae_dy": 0.0025447786320000887,
      "pose_mae_dtheta": 0.07531414180994034,
      "pose_mae_dx": 0.02034170739352703,
      "pose_mae_dy": 0.029846539720892906,
      "pose_rmse_dtheta": 0.18986177444458008,
      "pose_rmse_dx": 0.05167694389820099,
      "pose_rmse_dy": 0.06737347692251205,
      "pose_rmse_mean": 0.10297073423862457,
      "rmse_dtheta": 0.024218199774622917,
      "rmse_dx": 0.004286249168217182,
      "rmse_dy": 0.005365906748920679,
      "rmse_mean": 0.011290119960904121,
      "rotation_flip": 0.008967120200395584,
      "sparse_tokens": 32121.0,
      "step": 8030,
      "turn_loss": 0.0931432917714119,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.3731183794833674,
      "grad_norm": 1.3796195983886719,
      "learning_rate": 2.511459481528182e-06,
      "loss": 0.2736,
      "mae_dtheta": 0.03287879750132561,
      "mae_dx": 0.01961815543472767,
      "mae_dy": 0.007883870974183083,
      "pose_mae_dtheta": 0.20520637929439545,
      "pose_mae_dx": 0.14986015856266022,
      "pose_mae_dy": 0.09128200262784958,
      "pose_rmse_dtheta": 0.3361653983592987,
      "pose_rmse_dx": 0.2886119484901428,
      "pose_rmse_dy": 0.197885200381279,
      "pose_rmse_mean": 0.27422085404396057,
      "rmse_dtheta": 0.04612453281879425,
      "rmse_dx": 0.034363046288490295,
      "rmse_dy": 0.01441128272563219,
      "rmse_mean": 0.031632956117391586,
      "rotation_flip": 0.010799136012792587,
      "sparse_tokens": 7445.0,
      "step": 8031,
      "turn_loss": 0.29728421568870544,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 11021.0,
      "epoch": 0.3731648392492102,
      "grad_norm": 0.664965808391571,
      "learning_rate": 2.510312748940222e-06,
      "loss": 0.1676,
      "mae_dtheta": 0.034010935574769974,
      "mae_dx": 0.007957297377288342,
      "mae_dy": 0.006404123734682798,
      "pose_mae_dtheta": 0.2968845069408417,
      "pose_mae_dx": 0.08728113770484924,
      "pose_mae_dy": 0.10348605364561081,
      "pose_rmse_dtheta": 0.48027265071868896,
      "pose_rmse_dx": 0.2206382304430008,
      "pose_rmse_dy": 0.22664333879947662,
      "pose_rmse_mean": 0.309184730052948,
      "rmse_dtheta": 0.050343021750450134,
      "rmse_dx": 0.020798325538635254,
      "rmse_dy": 0.011617189273238182,
      "rmse_mean": 0.027586180716753006,
      "rotation_flip": 0.02012072503566742,
      "sparse_tokens": 8865.0,
      "step": 8032,
      "turn_loss": 0.28079503774642944,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.37321129901505296,
      "grad_norm": 0.6109434366226196,
      "learning_rate": 2.509166190457425e-06,
      "loss": 0.098,
      "mae_dtheta": 0.030537625774741173,
      "mae_dx": 0.012125509791076183,
      "mae_dy": 0.005083337426185608,
      "pose_mae_dtheta": 0.20594331622123718,
      "pose_mae_dx": 0.10425904393196106,
      "pose_mae_dy": 0.05288344994187355,
      "pose_rmse_dtheta": 0.37949338555336,
      "pose_rmse_dx": 0.23522253334522247,
      "pose_rmse_dy": 0.10944072157144547,
      "pose_rmse_mean": 0.2413855642080307,
      "rmse_dtheta": 0.048737380653619766,
      "rmse_dx": 0.024399960413575172,
      "rmse_dy": 0.009899946860969067,
      "rmse_mean": 0.027679096907377243,
      "rotation_flip": 0.00522193219512701,
      "sparse_tokens": 6317.0,
      "step": 8033,
      "turn_loss": 0.2560144364833832,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 30170.0,
      "epoch": 0.37325775878089573,
      "grad_norm": 0.5527350306510925,
      "learning_rate": 2.5080198061599757e-06,
      "loss": 0.1721,
      "mae_dtheta": 0.02983178198337555,
      "mae_dx": 0.009845376014709473,
      "mae_dy": 0.006620755884796381,
      "pose_mae_dtheta": 0.2245171070098877,
      "pose_mae_dx": 0.09242833405733109,
      "pose_mae_dy": 0.05756434053182602,
      "pose_rmse_dtheta": 0.4316768944263458,
      "pose_rmse_dx": 0.2320210039615631,
      "pose_rmse_dy": 0.13606317341327667,
      "pose_rmse_mean": 0.2665870189666748,
      "rmse_dtheta": 0.047613970935344696,
      "rmse_dx": 0.021194083616137505,
      "rmse_dy": 0.015406114980578423,
      "rmse_mean": 0.028071392327547073,
      "rotation_flip": 0.01172413770109415,
      "sparse_tokens": 24492.0,
      "step": 8034,
      "turn_loss": 0.2683960795402527,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.3733042185467385,
      "grad_norm": 0.6255490779876709,
      "learning_rate": 2.5068735961280367e-06,
      "loss": 0.1395,
      "mae_dtheta": 0.02883511781692505,
      "mae_dx": 0.01227940060198307,
      "mae_dy": 0.0037851990200579166,
      "pose_mae_dtheta": 0.21694765985012054,
      "pose_mae_dx": 0.10138300061225891,
      "pose_mae_dy": 0.04751744121313095,
      "pose_rmse_dtheta": 0.39585819840431213,
      "pose_rmse_dx": 0.23346470296382904,
      "pose_rmse_dy": 0.11696254462003708,
      "pose_rmse_mean": 0.24876181781291962,
      "rmse_dtheta": 0.045838549733161926,
      "rmse_dx": 0.02520863525569439,
      "rmse_dy": 0.007270126137882471,
      "rmse_mean": 0.026105772703886032,
      "rotation_flip": 0.011299435049295425,
      "sparse_tokens": 23605.0,
      "step": 8035,
      "turn_loss": 0.23772843182086945,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.3733506783125813,
      "grad_norm": 0.7752301692962646,
      "learning_rate": 2.505727560441767e-06,
      "loss": 0.1503,
      "mae_dtheta": 0.03757527843117714,
      "mae_dx": 0.011797789484262466,
      "mae_dy": 0.006543334107846022,
      "pose_mae_dtheta": 0.33475661277770996,
      "pose_mae_dx": 0.09479602426290512,
      "pose_mae_dy": 0.07552278786897659,
      "pose_rmse_dtheta": 0.5122770667076111,
      "pose_rmse_dx": 0.1770363599061966,
      "pose_rmse_dy": 0.18447570502758026,
      "pose_rmse_mean": 0.29126304388046265,
      "rmse_dtheta": 0.053077757358551025,
      "rmse_dx": 0.023540088906884193,
      "rmse_dy": 0.012207749299705029,
      "rmse_mean": 0.029608530923724174,
      "rotation_flip": 0.013452914543449879,
      "sparse_tokens": 6898.0,
      "step": 8036,
      "turn_loss": 0.29763004183769226,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.37339713807842406,
      "grad_norm": 0.41614237427711487,
      "learning_rate": 2.504581699181306e-06,
      "loss": 0.087,
      "mae_dtheta": 0.009101497940719128,
      "mae_dx": 0.002242779592052102,
      "mae_dy": 0.001762495143339038,
      "pose_mae_dtheta": 0.06608733534812927,
      "pose_mae_dx": 0.01962154358625412,
      "pose_mae_dy": 0.017007917165756226,
      "pose_rmse_dtheta": 0.19824457168579102,
      "pose_rmse_dx": 0.05708715319633484,
      "pose_rmse_dy": 0.04946240782737732,
      "pose_rmse_mean": 0.10159804672002792,
      "rmse_dtheta": 0.023853439837694168,
      "rmse_dx": 0.007212028373032808,
      "rmse_dy": 0.005585215520113707,
      "rmse_mean": 0.012216894887387753,
      "rotation_flip": 0.0046005854383111,
      "sparse_tokens": 32169.0,
      "step": 8037,
      "turn_loss": 0.0784682035446167,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.37344359784426684,
      "grad_norm": 0.4373011887073517,
      "learning_rate": 2.5034360124267867e-06,
      "loss": 0.0691,
      "mae_dtheta": 0.009690612554550171,
      "mae_dx": 0.0014574379893019795,
      "mae_dy": 0.0015356092480942607,
      "pose_mae_dtheta": 0.06644934415817261,
      "pose_mae_dx": 0.016418758779764175,
      "pose_mae_dy": 0.0243476964533329,
      "pose_rmse_dtheta": 0.1681336611509323,
      "pose_rmse_dx": 0.03973771259188652,
      "pose_rmse_dy": 0.055234260857105255,
      "pose_rmse_mean": 0.08770187944173813,
      "rmse_dtheta": 0.021459857001900673,
      "rmse_dx": 0.005053272936493158,
      "rmse_dy": 0.003016285365447402,
      "rmse_mean": 0.009843138977885246,
      "rotation_flip": 0.009166998788714409,
      "sparse_tokens": 32137.0,
      "step": 8038,
      "turn_loss": 0.07502476871013641,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.37349005761010967,
      "grad_norm": 0.4422359764575958,
      "learning_rate": 2.5022905002583277e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.037503961473703384,
      "mae_dx": 0.010340942069888115,
      "mae_dy": 0.0047998568043112755,
      "pose_mae_dtheta": 0.2467775195837021,
      "pose_mae_dx": 0.06911682337522507,
      "pose_mae_dy": 0.055954184383153915,
      "pose_rmse_dtheta": 0.4525202214717865,
      "pose_rmse_dx": 0.15729095041751862,
      "pose_rmse_dy": 0.12502148747444153,
      "pose_rmse_mean": 0.24494421482086182,
      "rmse_dtheta": 0.05418425425887108,
      "rmse_dx": 0.02207656018435955,
      "rmse_dy": 0.008888664655387402,
      "rmse_mean": 0.028383158147335052,
      "rotation_flip": 0.014784946106374264,
      "sparse_tokens": 11636.0,
      "step": 8039,
      "turn_loss": 0.3191415071487427,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.37353651737595245,
      "grad_norm": 0.47780928015708923,
      "learning_rate": 2.5011451627560334e-06,
      "loss": 0.0758,
      "mae_dtheta": 0.009152512066066265,
      "mae_dx": 0.001899339142255485,
      "mae_dy": 0.002298818901181221,
      "pose_mae_dtheta": 0.059871841222047806,
      "pose_mae_dx": 0.022279944270849228,
      "pose_mae_dy": 0.024324268102645874,
      "pose_rmse_dtheta": 0.15264137089252472,
      "pose_rmse_dx": 0.0648518055677414,
      "pose_rmse_dy": 0.06219692528247833,
      "pose_rmse_mean": 0.09323003143072128,
      "rmse_dtheta": 0.021762367337942123,
      "rmse_dx": 0.00540614128112793,
      "rmse_dy": 0.00593752134591341,
      "rmse_mean": 0.011035343632102013,
      "rotation_flip": 0.0033296337351202965,
      "sparse_tokens": 32121.0,
      "step": 8040,
      "turn_loss": 0.08675795048475266,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3735829771417952,
      "grad_norm": 0.42112666368484497,
      "learning_rate": 2.5000000000000015e-06,
      "loss": 0.0971,
      "mae_dtheta": 0.006178633309900761,
      "mae_dx": 0.0012646177783608437,
      "mae_dy": 0.0010498985648155212,
      "pose_mae_dtheta": 0.0457947663962841,
      "pose_mae_dx": 0.013131887651979923,
      "pose_mae_dy": 0.012387499213218689,
      "pose_rmse_dtheta": 0.1970745325088501,
      "pose_rmse_dx": 0.03946737200021744,
      "pose_rmse_dy": 0.03633937984704971,
      "pose_rmse_mean": 0.09096042811870575,
      "rmse_dtheta": 0.022151708602905273,
      "rmse_dx": 0.004134113434702158,
      "rmse_dy": 0.0029541736003011465,
      "rmse_mean": 0.009746665135025978,
      "rotation_flip": 0.003816793905571103,
      "sparse_tokens": 32057.0,
      "step": 8041,
      "turn_loss": 0.047570593655109406,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20777.0,
      "epoch": 0.373629436907638,
      "grad_norm": 0.3922041356563568,
      "learning_rate": 2.4988550120703086e-06,
      "loss": 0.0935,
      "mae_dtheta": 0.02559962309896946,
      "mae_dx": 0.011852463707327843,
      "mae_dy": 0.004189417697489262,
      "pose_mae_dtheta": 0.19774629175662994,
      "pose_mae_dx": 0.09420498460531235,
      "pose_mae_dy": 0.055904000997543335,
      "pose_rmse_dtheta": 0.3675072193145752,
      "pose_rmse_dx": 0.2127525508403778,
      "pose_rmse_dy": 0.14783135056495667,
      "pose_rmse_mean": 0.24269704520702362,
      "rmse_dtheta": 0.043445080518722534,
      "rmse_dx": 0.024938024580478668,
      "rmse_dy": 0.009071637876331806,
      "rmse_mean": 0.025818249210715294,
      "rotation_flip": 0.011428571306169033,
      "sparse_tokens": 16443.0,
      "step": 8042,
      "turn_loss": 0.17370674014091492,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3736758966734808,
      "grad_norm": 0.4962049424648285,
      "learning_rate": 2.49771019904703e-06,
      "loss": 0.1269,
      "mae_dtheta": 0.006338794250041246,
      "mae_dx": 0.0012304108822718263,
      "mae_dy": 0.0007391714607365429,
      "pose_mae_dtheta": 0.04468962922692299,
      "pose_mae_dx": 0.011032802052795887,
      "pose_mae_dy": 0.008346994407474995,
      "pose_rmse_dtheta": 0.17731012403964996,
      "pose_rmse_dx": 0.02626470848917961,
      "pose_rmse_dy": 0.02109566144645214,
      "pose_rmse_mean": 0.07489016652107239,
      "rmse_dtheta": 0.02163044922053814,
      "rmse_dx": 0.0033524599857628345,
      "rmse_dy": 0.0018076602136716247,
      "rmse_mean": 0.008930189535021782,
      "rotation_flip": 0.002754820976406336,
      "sparse_tokens": 32201.0,
      "step": 8043,
      "turn_loss": 0.04482614994049072,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32114.0,
      "epoch": 0.37372235643932356,
      "grad_norm": 0.8006911277770996,
      "learning_rate": 2.4965655610102176e-06,
      "loss": 0.1534,
      "mae_dtheta": 0.029243554919958115,
      "mae_dx": 0.010544191114604473,
      "mae_dy": 0.004542019218206406,
      "pose_mae_dtheta": 0.21453668177127838,
      "pose_mae_dx": 0.07999010384082794,
      "pose_mae_dy": 0.051832620054483414,
      "pose_rmse_dtheta": 0.40282142162323,
      "pose_rmse_dx": 0.18939842283725739,
      "pose_rmse_dy": 0.11760306358337402,
      "pose_rmse_mean": 0.2366076409816742,
      "rmse_dtheta": 0.04838240519165993,
      "rmse_dx": 0.022524742409586906,
      "rmse_dy": 0.00943121500313282,
      "rmse_mean": 0.026779454201459885,
      "rotation_flip": 0.012838801369071007,
      "sparse_tokens": 26140.0,
      "step": 8044,
      "turn_loss": 0.198517307639122,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.37376881620516633,
      "grad_norm": 0.5121622681617737,
      "learning_rate": 2.495421098039919e-06,
      "loss": 0.0782,
      "mae_dtheta": 0.0069840652868151665,
      "mae_dx": 0.0011323635699227452,
      "mae_dy": 0.0012559369206428528,
      "pose_mae_dtheta": 0.045259375125169754,
      "pose_mae_dx": 0.01320776715874672,
      "pose_mae_dy": 0.017495982348918915,
      "pose_rmse_dtheta": 0.15835335850715637,
      "pose_rmse_dx": 0.04748206213116646,
      "pose_rmse_dy": 0.05581146106123924,
      "pose_rmse_mean": 0.08721562474966049,
      "rmse_dtheta": 0.021196279674768448,
      "rmse_dx": 0.004421382211148739,
      "rmse_dy": 0.0037206243723630905,
      "rmse_mean": 0.00977942906320095,
      "rotation_flip": 0.00937274657189846,
      "sparse_tokens": 32057.0,
      "step": 8045,
      "turn_loss": 0.049101538956165314,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3738152759710091,
      "grad_norm": 0.45906761288642883,
      "learning_rate": 2.4942768102161704e-06,
      "loss": 0.1149,
      "mae_dtheta": 0.011831493116915226,
      "mae_dx": 0.002068911213427782,
      "mae_dy": 0.0033104014582931995,
      "pose_mae_dtheta": 0.08127972483634949,
      "pose_mae_dx": 0.029522312805056572,
      "pose_mae_dy": 0.04103033244609833,
      "pose_rmse_dtheta": 0.16269707679748535,
      "pose_rmse_dx": 0.07502354681491852,
      "pose_rmse_dy": 0.08749546110630035,
      "pose_rmse_mean": 0.10840536653995514,
      "rmse_dtheta": 0.02302018739283085,
      "rmse_dx": 0.006703144870698452,
      "rmse_dy": 0.006602259818464518,
      "rmse_mean": 0.012108530849218369,
      "rotation_flip": 0.0051387459971010685,
      "sparse_tokens": 32057.0,
      "step": 8046,
      "turn_loss": 0.10547669976949692,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3738617357368519,
      "grad_norm": 0.44902369379997253,
      "learning_rate": 2.493132697618986e-06,
      "loss": 0.155,
      "mae_dtheta": 0.00970158725976944,
      "mae_dx": 0.0021435257513076067,
      "mae_dy": 0.002084501087665558,
      "pose_mae_dtheta": 0.06715070456266403,
      "pose_mae_dx": 0.01686783693730831,
      "pose_mae_dy": 0.021362677216529846,
      "pose_rmse_dtheta": 0.1728905588388443,
      "pose_rmse_dx": 0.045580413192510605,
      "pose_rmse_dy": 0.052236273884773254,
      "pose_rmse_mean": 0.09023575484752655,
      "rmse_dtheta": 0.023506110534071922,
      "rmse_dx": 0.007956895045936108,
      "rmse_dy": 0.0064565143547952175,
      "rmse_mean": 0.012639839202165604,
      "rotation_flip": 0.0021404109429568052,
      "sparse_tokens": 32137.0,
      "step": 8047,
      "turn_loss": 0.08377361297607422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.37390819550269466,
      "grad_norm": 0.5370945334434509,
      "learning_rate": 2.4919887603283806e-06,
      "loss": 0.1238,
      "mae_dtheta": 0.05530934780836105,
      "mae_dx": 0.017528701573610306,
      "mae_dy": 0.012296189554035664,
      "pose_mae_dtheta": 0.46717390418052673,
      "pose_mae_dx": 0.1352592557668686,
      "pose_mae_dy": 0.07673316448926926,
      "pose_rmse_dtheta": 0.7131497859954834,
      "pose_rmse_dx": 0.2751244008541107,
      "pose_rmse_dy": 0.14295513927936554,
      "pose_rmse_mean": 0.37707647681236267,
      "rmse_dtheta": 0.07548367977142334,
      "rmse_dx": 0.029585836455225945,
      "rmse_dy": 0.02296607382595539,
      "rmse_mean": 0.042678531259298325,
      "rotation_flip": 0.02229299396276474,
      "sparse_tokens": 4628.0,
      "step": 8048,
      "turn_loss": 0.5824381113052368,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.37395465526853744,
      "grad_norm": 1.2484254837036133,
      "learning_rate": 2.4908449984243448e-06,
      "loss": 0.3103,
      "mae_dtheta": 0.02973444014787674,
      "mae_dx": 0.011679898016154766,
      "mae_dy": 0.002068785484880209,
      "pose_mae_dtheta": 0.2129286229610443,
      "pose_mae_dx": 0.10497181862592697,
      "pose_mae_dy": 0.025562219321727753,
      "pose_rmse_dtheta": 0.4425344169139862,
      "pose_rmse_dx": 0.21410703659057617,
      "pose_rmse_dy": 0.05600261315703392,
      "pose_rmse_mean": 0.23754803836345673,
      "rmse_dtheta": 0.05149272456765175,
      "rmse_dx": 0.02277999185025692,
      "rmse_dy": 0.004168258048593998,
      "rmse_mean": 0.026146991178393364,
      "rotation_flip": 0.010389610193669796,
      "sparse_tokens": 7116.0,
      "step": 8049,
      "turn_loss": 0.19464947283267975,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3740011150343802,
      "grad_norm": 0.35037320852279663,
      "learning_rate": 2.489701411986865e-06,
      "loss": 0.061,
      "mae_dtheta": 0.005337584298104048,
      "mae_dx": 0.0012931685196235776,
      "mae_dy": 0.0008065170841291547,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.350373238325119,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 166.1662139892578,
      "model/head/act_norm_mean": 122.83053188131314,
      "model/head/act_norm_min": 72.16919708251953,
      "model/head/act_over_embed": 84.41029146639573,
      "model/head/grad_frac": 0.0836886316537857,
      "model/head/grad_norm": 0.02932225726544857,
      "model/head/grad_zero_frac": 0.00020432301971595734,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6981090198863636,
      "model/head/update_ratio": 0.0004995959461666644,
      "model/head/weight_delta": 9.690857887268066,
      "model/head/weight_delta_rel": 0.17000634968280792,
      "model/head/weight_norm": 58.69194412231445,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4224039614200592,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.422322711207836,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.422244131565094,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2902241209895411,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11602412909269333,
      "model/modality_embedder.encoders.pose/grad_norm": 0.040651749819517136,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5299758583690987,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001312818261794746,
      "model/modality_embedder.encoders.pose/weight_delta": 3.0996389389038086,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10127486288547516,
      "model/modality_embedder.encoders.pose/weight_norm": 30.965251922607422,
      "model/modality_embedder/grad_frac": 0.11602412909269333,
      "model/modality_embedder/grad_norm": 0.040651749819517136,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5299758583690987,
      "model/modality_embedder/update_ratio": 0.001312818261794746,
      "model/modality_embedder/weight_delta": 3.0996389389038086,
      "model/modality_embedder/weight_delta_rel": 0.10127486288547516,
      "model/modality_embedder/weight_norm": 30.965251922607422,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 97.63138580322266,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.87974987974988,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.097760200500488,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.097597045252332,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06460057199001312,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.022634312510490417,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.000810419034678489,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.597748279571533,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09466351568698883,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.929147720336914,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 99.4076919555664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.918410293410293,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.388734817504883,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.811374205611763,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.061475176364183426,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02153925597667694,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007247779285535216,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2932300567626953,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11408006399869919,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.718421936035156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 101.13513946533203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.72367273929774,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.31147289276123,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.051967459558917,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.055247362703084946,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.019357196986675262,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0006308071897365153,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.560028314590454,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11953908205032349,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.68639373779297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 101.8835220336914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.401805755972422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.318367004394531,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.20519617954659,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.056916628032922745,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.019942063838243484,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006667054258286953,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.050795316696167,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10426170378923416,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.911357879638672,
      "model/normalizer/grad_frac": 0.2456258237361908,
      "model/normalizer/grad_norm": 0.08606071770191193,
      "model/normalizer/grad_zero_frac": 0.00023516594956163317,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010949330171570182,
      "model/normalizer/weight_delta": 6.437290668487549,
      "model/normalizer/weight_delta_rel": 0.08290857821702957,
      "model/normalizer/weight_norm": 78.59906768798828,
      "pose_mae_dtheta": 0.03505502641201019,
      "pose_mae_dx": 0.010544214397668839,
      "pose_mae_dy": 0.010992111638188362,
      "pose_rmse_dtheta": 0.11842495203018188,
      "pose_rmse_dx": 0.028153961524367332,
      "pose_rmse_dy": 0.029262453317642212,
      "pose_rmse_mean": 0.05861378833651543,
      "rmse_dtheta": 0.017118502408266068,
      "rmse_dx": 0.004105611238628626,
      "rmse_dy": 0.002026884350925684,
      "rmse_mean": 0.007750332355499268,
      "rotation_flip": 0.0037842951714992523,
      "sparse_tokens": 32185.0,
      "step": 8050,
      "turn_loss": 0.041450224816799164,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.374047574800223,
      "grad_norm": 0.42147716879844666,
      "learning_rate": 2.4885580010959153e-06,
      "loss": 0.08,
      "mae_dtheta": 0.03057100810110569,
      "mae_dx": 0.010479100979864597,
      "mae_dy": 0.004038356244564056,
      "pose_mae_dtheta": 0.2630157768726349,
      "pose_mae_dx": 0.082246333360672,
      "pose_mae_dy": 0.05224218964576721,
      "pose_rmse_dtheta": 0.49912410974502563,
      "pose_rmse_dx": 0.15791232883930206,
      "pose_rmse_dy": 0.11937561631202698,
      "pose_rmse_mean": 0.2588040232658386,
      "rmse_dtheta": 0.04962461441755295,
      "rmse_dx": 0.02112397365272045,
      "rmse_dy": 0.008234159089624882,
      "rmse_mean": 0.02632758393883705,
      "rotation_flip": 0.015706805512309074,
      "sparse_tokens": 6010.0,
      "step": 8051,
      "turn_loss": 0.2953125834465027,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.37409403456606577,
      "grad_norm": 0.6496838331222534,
      "learning_rate": 2.4874147658314503e-06,
      "loss": 0.1239,
      "mae_dtheta": 0.008174892514944077,
      "mae_dx": 0.0016937999753281474,
      "mae_dy": 0.0015073148533701897,
      "pose_mae_dtheta": 0.06140964850783348,
      "pose_mae_dx": 0.019708512350916862,
      "pose_mae_dy": 0.02315990813076496,
      "pose_rmse_dtheta": 0.17833779752254486,
      "pose_rmse_dx": 0.05140390619635582,
      "pose_rmse_dy": 0.05991261824965477,
      "pose_rmse_mean": 0.09655144065618515,
      "rmse_dtheta": 0.020522983744740486,
      "rmse_dx": 0.005732021760195494,
      "rmse_dy": 0.0033117327839136124,
      "rmse_mean": 0.00985557958483696,
      "rotation_flip": 0.002099737524986267,
      "sparse_tokens": 32073.0,
      "step": 8052,
      "turn_loss": 0.0665321946144104,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.37414049433190855,
      "grad_norm": 1.0329612493515015,
      "learning_rate": 2.486271706273421e-06,
      "loss": 0.2397,
      "mae_dtheta": 0.024686357006430626,
      "mae_dx": 0.01158506702631712,
      "mae_dy": 0.003984981216490269,
      "pose_mae_dtheta": 0.21382386982440948,
      "pose_mae_dx": 0.07272524386644363,
      "pose_mae_dy": 0.04663575440645218,
      "pose_rmse_dtheta": 0.40959790349006653,
      "pose_rmse_dx": 0.1796225756406784,
      "pose_rmse_dy": 0.10905280709266663,
      "pose_rmse_mean": 0.2327577769756317,
      "rmse_dtheta": 0.04092453792691231,
      "rmse_dx": 0.024085920304059982,
      "rmse_dy": 0.007909923791885376,
      "rmse_mean": 0.02430679462850094,
      "rotation_flip": 0.004938271827995777,
      "sparse_tokens": 7113.0,
      "step": 8053,
      "turn_loss": 0.1716931313276291,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3741869540977513,
      "grad_norm": 0.5409157276153564,
      "learning_rate": 2.485128822501759e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.009033212438225746,
      "mae_dx": 0.0011287957895547152,
      "mae_dy": 0.0016433070413768291,
      "pose_mae_dtheta": 0.0650654211640358,
      "pose_mae_dx": 0.012593227438628674,
      "pose_mae_dy": 0.019182486459612846,
      "pose_rmse_dtheta": 0.19507034122943878,
      "pose_rmse_dx": 0.034338999539613724,
      "pose_rmse_dy": 0.052453432232141495,
      "pose_rmse_mean": 0.09395425766706467,
      "rmse_dtheta": 0.024581292644143105,
      "rmse_dx": 0.0037961064372211695,
      "rmse_dy": 0.00451167905703187,
      "rmse_mean": 0.01096302643418312,
      "rotation_flip": 0.003341288771480322,
      "sparse_tokens": 32105.0,
      "step": 8054,
      "turn_loss": 0.05671688914299011,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.3742334138635941,
      "grad_norm": 0.5798892974853516,
      "learning_rate": 2.48398611459639e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.027965620160102844,
      "mae_dx": 0.006441628094762564,
      "mae_dy": 0.007459378335624933,
      "pose_mae_dtheta": 0.22950619459152222,
      "pose_mae_dx": 0.04228696599602699,
      "pose_mae_dy": 0.10284505784511566,
      "pose_rmse_dtheta": 0.39612671732902527,
      "pose_rmse_dx": 0.08805390447378159,
      "pose_rmse_dy": 0.23408930003643036,
      "pose_rmse_mean": 0.23942331969738007,
      "rmse_dtheta": 0.04311066493391991,
      "rmse_dx": 0.015689440071582794,
      "rmse_dy": 0.015700563788414,
      "rmse_mean": 0.0248335562646389,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 3900.0,
      "step": 8055,
      "turn_loss": 0.24856765568256378,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.37427987362943693,
      "grad_norm": 0.486393004655838,
      "learning_rate": 2.4828435826372204e-06,
      "loss": 0.1106,
      "mae_dtheta": 0.011870317161083221,
      "mae_dx": 0.0017676695715636015,
      "mae_dy": 0.002758106216788292,
      "pose_mae_dtheta": 0.07294546067714691,
      "pose_mae_dx": 0.0224018394947052,
      "pose_mae_dy": 0.029899222776293755,
      "pose_rmse_dtheta": 0.1545814573764801,
      "pose_rmse_dx": 0.056065503507852554,
      "pose_rmse_dy": 0.06567446887493134,
      "pose_rmse_mean": 0.0921071395277977,
      "rmse_dtheta": 0.023312883451581,
      "rmse_dx": 0.004543533083051443,
      "rmse_dy": 0.005797819700092077,
      "rmse_mean": 0.011218078434467316,
      "rotation_flip": 0.011748445220291615,
      "sparse_tokens": 32153.0,
      "step": 8056,
      "turn_loss": 0.10988620668649673,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3743263333952797,
      "grad_norm": 0.48331165313720703,
      "learning_rate": 2.4817012267041524e-06,
      "loss": 0.0895,
      "mae_dtheta": 0.0122599545866251,
      "mae_dx": 0.001691396115347743,
      "mae_dy": 0.0026162457652390003,
      "pose_mae_dtheta": 0.07923462986946106,
      "pose_mae_dx": 0.025408798828721046,
      "pose_mae_dy": 0.029851101338863373,
      "pose_rmse_dtheta": 0.19874969124794006,
      "pose_rmse_dx": 0.07075399160385132,
      "pose_rmse_dy": 0.0672299861907959,
      "pose_rmse_mean": 0.11224456131458282,
      "rmse_dtheta": 0.02630438655614853,
      "rmse_dx": 0.005395551212131977,
      "rmse_dy": 0.005517397075891495,
      "rmse_mean": 0.012405778281390667,
      "rotation_flip": 0.01217038556933403,
      "sparse_tokens": 32041.0,
      "step": 8057,
      "turn_loss": 0.0986679270863533,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3743727931611225,
      "grad_norm": 0.5042652487754822,
      "learning_rate": 2.480559046877067e-06,
      "loss": 0.0953,
      "mae_dtheta": 0.007189193740487099,
      "mae_dx": 0.0013902904465794563,
      "mae_dy": 0.00031792407389730215,
      "pose_mae_dtheta": 0.054974328726530075,
      "pose_mae_dx": 0.011549986898899078,
      "pose_mae_dy": 0.006063065957278013,
      "pose_rmse_dtheta": 0.22748878598213196,
      "pose_rmse_dx": 0.03524491935968399,
      "pose_rmse_dy": 0.020699406042695045,
      "pose_rmse_mean": 0.09447770565748215,
      "rmse_dtheta": 0.02764429897069931,
      "rmse_dx": 0.004450844135135412,
      "rmse_dy": 0.0008003278635442257,
      "rmse_mean": 0.010965156368911266,
      "rotation_flip": 0.000729926978237927,
      "sparse_tokens": 32169.0,
      "step": 8058,
      "turn_loss": 0.044507015496492386,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.37441925292696526,
      "grad_norm": 0.5938777327537537,
      "learning_rate": 2.4794170432358415e-06,
      "loss": 0.1374,
      "mae_dtheta": 0.022952519357204437,
      "mae_dx": 0.01281592808663845,
      "mae_dy": 0.0050264266319572926,
      "pose_mae_dtheta": 0.20138706266880035,
      "pose_mae_dx": 0.1177871897816658,
      "pose_mae_dy": 0.06608517467975616,
      "pose_rmse_dtheta": 0.302616149187088,
      "pose_rmse_dx": 0.26757460832595825,
      "pose_rmse_dy": 0.12669676542282104,
      "pose_rmse_mean": 0.23229585587978363,
      "rmse_dtheta": 0.033979445695877075,
      "rmse_dx": 0.026627711951732635,
      "rmse_dy": 0.008176330476999283,
      "rmse_mean": 0.02292783185839653,
      "rotation_flip": 0.0058823530562222,
      "sparse_tokens": 8876.0,
      "step": 8059,
      "turn_loss": 0.1748782992362976,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.37446571269280804,
      "grad_norm": 0.716543972492218,
      "learning_rate": 2.4782752158603335e-06,
      "loss": 0.1102,
      "mae_dtheta": 0.01118811871856451,
      "mae_dx": 0.003898889059200883,
      "mae_dy": 0.003256328869611025,
      "pose_mae_dtheta": 0.0845785140991211,
      "pose_mae_dx": 0.03701920062303543,
      "pose_mae_dy": 0.033203206956386566,
      "pose_rmse_dtheta": 0.21406586468219757,
      "pose_rmse_dx": 0.13397547602653503,
      "pose_rmse_dy": 0.09819964319467545,
      "pose_rmse_mean": 0.14874699711799622,
      "rmse_dtheta": 0.02619708701968193,
      "rmse_dx": 0.013067309744656086,
      "rmse_dy": 0.010222633369266987,
      "rmse_mean": 0.016495676711201668,
      "rotation_flip": 0.002939447294920683,
      "sparse_tokens": 32057.0,
      "step": 8060,
      "turn_loss": 0.11055515706539154,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3745121724586508,
      "grad_norm": 0.48600950837135315,
      "learning_rate": 2.4771335648303944e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.010344993323087692,
      "mae_dx": 0.0025722167920321226,
      "mae_dy": 0.0022813528776168823,
      "pose_mae_dtheta": 0.06415507197380066,
      "pose_mae_dx": 0.027133533731102943,
      "pose_mae_dy": 0.027296658605337143,
      "pose_rmse_dtheta": 0.15118280053138733,
      "pose_rmse_dx": 0.08055548369884491,
      "pose_rmse_dy": 0.07332537323236465,
      "pose_rmse_mean": 0.10168789327144623,
      "rmse_dtheta": 0.022510558366775513,
      "rmse_dx": 0.008665450848639011,
      "rmse_dy": 0.0052209217101335526,
      "rmse_mean": 0.012132309377193451,
      "rotation_flip": 0.0067658997140824795,
      "sparse_tokens": 32121.0,
      "step": 8061,
      "turn_loss": 0.10804899036884308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.3745586322244936,
      "grad_norm": 0.33896228671073914,
      "learning_rate": 2.4759920902258584e-06,
      "loss": 0.0788,
      "mae_dtheta": 0.0072364192456007,
      "mae_dx": 0.0025206708814948797,
      "mae_dy": 0.0023457915522158146,
      "pose_mae_dtheta": 0.05387960746884346,
      "pose_mae_dx": 0.034609902650117874,
      "pose_mae_dy": 0.024365123361349106,
      "pose_rmse_dtheta": 0.15890991687774658,
      "pose_rmse_dx": 0.11667122691869736,
      "pose_rmse_dy": 0.08193984627723694,
      "pose_rmse_mean": 0.11917366832494736,
      "rmse_dtheta": 0.01984907127916813,
      "rmse_dx": 0.008172832429409027,
      "rmse_dy": 0.007836475968360901,
      "rmse_mean": 0.011952793225646019,
      "rotation_flip": 0.003692762227728963,
      "sparse_tokens": 32025.0,
      "step": 8062,
      "turn_loss": 0.09220786392688751,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.37460509199033637,
      "grad_norm": 0.7740055322647095,
      "learning_rate": 2.4748507921265514e-06,
      "loss": 0.1771,
      "mae_dtheta": 0.03957045078277588,
      "mae_dx": 0.008433600887656212,
      "mae_dy": 0.0024966264609247446,
      "pose_mae_dtheta": 0.3528762757778168,
      "pose_mae_dx": 0.06674723327159882,
      "pose_mae_dy": 0.04012800008058548,
      "pose_rmse_dtheta": 0.6641987562179565,
      "pose_rmse_dx": 0.15871559083461761,
      "pose_rmse_dy": 0.12447461485862732,
      "pose_rmse_mean": 0.3157963454723358,
      "rmse_dtheta": 0.06336801499128342,
      "rmse_dx": 0.02013828232884407,
      "rmse_dy": 0.005768089555203915,
      "rmse_mean": 0.029758131131529808,
      "rotation_flip": 0.021472392603754997,
      "sparse_tokens": 6635.0,
      "step": 8063,
      "turn_loss": 0.1875053495168686,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 26607.0,
      "epoch": 0.37465155175617915,
      "grad_norm": 0.6856012344360352,
      "learning_rate": 2.4737096706122823e-06,
      "loss": 0.1802,
      "mae_dtheta": 0.0315459780395031,
      "mae_dx": 0.01175354141741991,
      "mae_dy": 0.004814671352505684,
      "pose_mae_dtheta": 0.24400578439235687,
      "pose_mae_dx": 0.09768751263618469,
      "pose_mae_dy": 0.05424816906452179,
      "pose_rmse_dtheta": 0.47288572788238525,
      "pose_rmse_dx": 0.21442775428295135,
      "pose_rmse_dy": 0.15106838941574097,
      "pose_rmse_mean": 0.2794606387615204,
      "rmse_dtheta": 0.0522809661924839,
      "rmse_dx": 0.023909544572234154,
      "rmse_dy": 0.012110507115721703,
      "rmse_mean": 0.02943367324769497,
      "rotation_flip": 0.008750994689762592,
      "sparse_tokens": 20090.0,
      "step": 8064,
      "turn_loss": 0.2536645829677582,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3746980115220219,
      "grad_norm": 0.5265747308731079,
      "learning_rate": 2.4725687257628533e-06,
      "loss": 0.124,
      "mae_dtheta": 0.00907459482550621,
      "mae_dx": 0.002055747900158167,
      "mae_dy": 0.002258335705846548,
      "pose_mae_dtheta": 0.057668112218379974,
      "pose_mae_dx": 0.024082697927951813,
      "pose_mae_dy": 0.023286866024136543,
      "pose_rmse_dtheta": 0.14320674538612366,
      "pose_rmse_dx": 0.06667459011077881,
      "pose_rmse_dy": 0.06063609942793846,
      "pose_rmse_mean": 0.09017248451709747,
      "rmse_dtheta": 0.02149532549083233,
      "rmse_dx": 0.006978084333240986,
      "rmse_dy": 0.005551990587264299,
      "rmse_mean": 0.011341800913214684,
      "rotation_flip": 0.002883229171857238,
      "sparse_tokens": 32073.0,
      "step": 8065,
      "turn_loss": 0.08189841359853745,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3747444712878647,
      "grad_norm": 0.4848177134990692,
      "learning_rate": 2.4714279576580487e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.0075041670352220535,
      "mae_dx": 0.0013570261653512716,
      "mae_dy": 0.0017468607984483242,
      "pose_mae_dtheta": 0.04661180451512337,
      "pose_mae_dx": 0.01877591386437416,
      "pose_mae_dy": 0.019664354622364044,
      "pose_rmse_dtheta": 0.1096373200416565,
      "pose_rmse_dx": 0.04623002931475639,
      "pose_rmse_dy": 0.04923377186059952,
      "pose_rmse_mean": 0.06836704909801483,
      "rmse_dtheta": 0.017443226650357246,
      "rmse_dx": 0.0035666499752551317,
      "rmse_dy": 0.00407015485689044,
      "rmse_mean": 0.008360011503100395,
      "rotation_flip": 0.004588909912854433,
      "sparse_tokens": 32153.0,
      "step": 8066,
      "turn_loss": 0.06819149106740952,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.3747909310537075,
      "grad_norm": 0.942304253578186,
      "learning_rate": 2.470287366377645e-06,
      "loss": 0.2708,
      "mae_dtheta": 0.022041229531168938,
      "mae_dx": 0.008840304799377918,
      "mae_dy": 0.005767915863543749,
      "pose_mae_dtheta": 0.13868258893489838,
      "pose_mae_dx": 0.077152781188488,
      "pose_mae_dy": 0.0790577307343483,
      "pose_rmse_dtheta": 0.23402686417102814,
      "pose_rmse_dx": 0.1909751445055008,
      "pose_rmse_dy": 0.18047398328781128,
      "pose_rmse_mean": 0.201825350522995,
      "rmse_dtheta": 0.033486805856227875,
      "rmse_dx": 0.020932747051119804,
      "rmse_dy": 0.012608431279659271,
      "rmse_mean": 0.022342663258314133,
      "rotation_flip": 0.014010507613420486,
      "sparse_tokens": 10868.0,
      "step": 8067,
      "turn_loss": 0.20239724218845367,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.37483739081955025,
      "grad_norm": 0.5704426765441895,
      "learning_rate": 2.469146952001403e-06,
      "loss": 0.1309,
      "mae_dtheta": 0.014196803793311119,
      "mae_dx": 0.002961506135761738,
      "mae_dy": 0.003818764118477702,
      "pose_mae_dtheta": 0.09346448630094528,
      "pose_mae_dx": 0.028267191722989082,
      "pose_mae_dy": 0.03713550046086311,
      "pose_rmse_dtheta": 0.2373584657907486,
      "pose_rmse_dx": 0.0688949003815651,
      "pose_rmse_dy": 0.09103751927614212,
      "pose_rmse_mean": 0.132430300116539,
      "rmse_dtheta": 0.029057305306196213,
      "rmse_dx": 0.009775574319064617,
      "rmse_dy": 0.00845316145569086,
      "rmse_mean": 0.01576201431453228,
      "rotation_flip": 0.006266490556299686,
      "sparse_tokens": 32073.0,
      "step": 8068,
      "turn_loss": 0.1231667771935463,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.37488385058539303,
      "grad_norm": 0.5892940163612366,
      "learning_rate": 2.468006714609072e-06,
      "loss": 0.1753,
      "mae_dtheta": 0.04222559183835983,
      "mae_dx": 0.014561722986400127,
      "mae_dy": 0.005706277210265398,
      "pose_mae_dtheta": 0.3679620623588562,
      "pose_mae_dx": 0.1258515864610672,
      "pose_mae_dy": 0.05361771583557129,
      "pose_rmse_dtheta": 0.5818920135498047,
      "pose_rmse_dx": 0.27181902527809143,
      "pose_rmse_dy": 0.12430866807699203,
      "pose_rmse_mean": 0.32600656151771545,
      "rmse_dtheta": 0.0590389221906662,
      "rmse_dx": 0.027114173397421837,
      "rmse_dy": 0.012461005710065365,
      "rmse_mean": 0.032871369272470474,
      "rotation_flip": 0.018284106627106667,
      "sparse_tokens": 13060.0,
      "step": 8069,
      "turn_loss": 0.3448491096496582,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3749303103512358,
      "grad_norm": 0.46312981843948364,
      "learning_rate": 2.4668666542803925e-06,
      "loss": 0.147,
      "mae_dtheta": 0.005425873678177595,
      "mae_dx": 0.001352196093648672,
      "mae_dy": 0.001109248143620789,
      "pose_mae_dtheta": 0.0367564857006073,
      "pose_mae_dx": 0.012745839543640614,
      "pose_mae_dy": 0.014313863590359688,
      "pose_rmse_dtheta": 0.09174764901399612,
      "pose_rmse_dx": 0.02974717691540718,
      "pose_rmse_dy": 0.03690541163086891,
      "pose_rmse_mean": 0.05280008167028427,
      "rmse_dtheta": 0.01421577949076891,
      "rmse_dx": 0.003790453774854541,
      "rmse_dy": 0.0025269160978496075,
      "rmse_mean": 0.006844383664429188,
      "rotation_flip": 0.002399040386080742,
      "sparse_tokens": 32185.0,
      "step": 8070,
      "turn_loss": 0.04984661936759949,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.3749767701170786,
      "grad_norm": 0.5757003426551819,
      "learning_rate": 2.465726771095086e-06,
      "loss": 0.1475,
      "mae_dtheta": 0.03312494605779648,
      "mae_dx": 0.00821407325565815,
      "mae_dy": 0.004142412915825844,
      "pose_mae_dtheta": 0.24120524525642395,
      "pose_mae_dx": 0.05883978679776192,
      "pose_mae_dy": 0.044243354350328445,
      "pose_rmse_dtheta": 0.4870920181274414,
      "pose_rmse_dx": 0.15217123925685883,
      "pose_rmse_dy": 0.1089867651462555,
      "pose_rmse_mean": 0.24941667914390564,
      "rmse_dtheta": 0.05496800318360329,
      "rmse_dx": 0.020042121410369873,
      "rmse_dy": 0.008882683701813221,
      "rmse_mean": 0.027964269742369652,
      "rotation_flip": 0.010300429537892342,
      "sparse_tokens": 20760.0,
      "step": 8071,
      "turn_loss": 0.19840461015701294,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3750232298829214,
      "grad_norm": 0.8242975473403931,
      "learning_rate": 2.4645870651328678e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.009570787660777569,
      "mae_dx": 0.0014627649215981364,
      "mae_dy": 0.0019271459896117449,
      "pose_mae_dtheta": 0.06529170274734497,
      "pose_mae_dx": 0.017603537067770958,
      "pose_mae_dy": 0.022531501948833466,
      "pose_rmse_dtheta": 0.17347556352615356,
      "pose_rmse_dx": 0.0433695912361145,
      "pose_rmse_dy": 0.05254499241709709,
      "pose_rmse_mean": 0.08979671448469162,
      "rmse_dtheta": 0.02072541043162346,
      "rmse_dx": 0.00429953308776021,
      "rmse_dy": 0.004157250747084618,
      "rmse_mean": 0.009727397933602333,
      "rotation_flip": 0.0056841252371668816,
      "sparse_tokens": 32105.0,
      "step": 8072,
      "turn_loss": 0.07030993700027466,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25636.0,
      "epoch": 0.3750696896487642,
      "grad_norm": 0.5713163018226624,
      "learning_rate": 2.4634475364734356e-06,
      "loss": 0.1355,
      "mae_dtheta": 0.031031429767608643,
      "mae_dx": 0.011336836032569408,
      "mae_dy": 0.006232216488569975,
      "pose_mae_dtheta": 0.232890322804451,
      "pose_mae_dx": 0.08936634659767151,
      "pose_mae_dy": 0.06589988619089127,
      "pose_rmse_dtheta": 0.4112754166126251,
      "pose_rmse_dx": 0.2085222750902176,
      "pose_rmse_dy": 0.1538930982351303,
      "pose_rmse_mean": 0.25789695978164673,
      "rmse_dtheta": 0.04772372171282768,
      "rmse_dx": 0.022655997425317764,
      "rmse_dy": 0.013811087235808372,
      "rmse_mean": 0.02806360274553299,
      "rotation_flip": 0.01568627543747425,
      "sparse_tokens": 20441.0,
      "step": 8073,
      "turn_loss": 0.22764341533184052,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 17859.0,
      "epoch": 0.37511614941460697,
      "grad_norm": 0.5473049283027649,
      "learning_rate": 2.462308185196481e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.038439374417066574,
      "mae_dx": 0.014876874163746834,
      "mae_dy": 0.008784517645835876,
      "pose_mae_dtheta": 0.3365812599658966,
      "pose_mae_dx": 0.15168792009353638,
      "pose_mae_dy": 0.09980218857526779,
      "pose_rmse_dtheta": 0.60069739818573,
      "pose_rmse_dx": 0.2929059863090515,
      "pose_rmse_dy": 0.22122074663639069,
      "pose_rmse_mean": 0.37160807847976685,
      "rmse_dtheta": 0.05914737284183502,
      "rmse_dx": 0.02783159166574478,
      "rmse_dy": 0.018158450722694397,
      "rmse_mean": 0.0350458063185215,
      "rotation_flip": 0.019556714221835136,
      "sparse_tokens": 13689.0,
      "step": 8074,
      "turn_loss": 0.31568366289138794,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.37516260918044975,
      "grad_norm": 0.6329689025878906,
      "learning_rate": 2.4611690113816745e-06,
      "loss": 0.1357,
      "mae_dtheta": 0.026822011917829514,
      "mae_dx": 0.008978287689387798,
      "mae_dy": 0.004175983835011721,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.632969081401825,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.2096405029297,
      "model/head/act_norm_mean": 111.99928911994485,
      "model/head/act_norm_min": 78.82864379882812,
      "model/head/act_over_embed": 76.96696003709107,
      "model/head/grad_frac": 0.10998749732971191,
      "model/head/grad_norm": 0.06961868703365326,
      "model/head/grad_zero_frac": 0.00018116217688657343,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6890079273897058,
      "model/head/update_ratio": 0.0011861518723890185,
      "model/head/weight_delta": 9.696104049682617,
      "model/head/weight_delta_rel": 0.17009837925434113,
      "model/head/weight_norm": 58.692893981933594,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223690330982208,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222820116126019,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4222315847873688,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29019615184666064,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07574537396430969,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04794447869062424,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5352128623188406,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015483333263546228,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1011135578155518,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10132304579019547,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96521759033203,
      "model/modality_embedder/grad_frac": 0.07574537396430969,
      "model/modality_embedder/grad_norm": 0.04794447869062424,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5352128623188406,
      "model/modality_embedder/update_ratio": 0.0015483333263546228,
      "model/modality_embedder/weight_delta": 3.1011135578155518,
      "model/modality_embedder/weight_delta_rel": 0.10132304579019547,
      "model/modality_embedder/weight_norm": 30.96521759033203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.76019287109375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.791099512721754,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.275796890258789,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.349466320925288,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07954350113868713,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05034857615828514,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018026720499619842,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6002581119537354,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09475497156381607,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.929969787597656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.99183654785156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.606710653011206,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.514923095703125,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.909961932404,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0822126716375351,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.052038080990314484,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017509737517684698,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.2965939044952393,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11419659107923508,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.71950912475586,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.54027557373047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.225205707282914,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.255509376525879,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.02220688628895,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08212045580148697,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.051979709416627884,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016938373446464539,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.563950300216675,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11967077851295471,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.687543869018555,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.82373809814453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.063422764939308,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.851398468017578,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.285446857969657,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07879737764596939,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04987630248069763,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016674201469868422,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0541582107543945,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10437663644552231,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.91225814819336,
      "model/normalizer/grad_frac": 0.30950501561164856,
      "model/normalizer/grad_norm": 0.1959071010351181,
      "model/normalizer/grad_zero_frac": 0.00022453030396718532,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002492446918040514,
      "model/normalizer/weight_delta": 6.444080352783203,
      "model/normalizer/weight_delta_rel": 0.08299602568149567,
      "model/normalizer/weight_norm": 78.60031127929688,
      "pose_mae_dtheta": 0.21734069287776947,
      "pose_mae_dx": 0.07500888407230377,
      "pose_mae_dy": 0.05571663752198219,
      "pose_rmse_dtheta": 0.41835108399391174,
      "pose_rmse_dx": 0.16893160343170166,
      "pose_rmse_dy": 0.13050733506679535,
      "pose_rmse_mean": 0.23926334083080292,
      "rmse_dtheta": 0.046524252742528915,
      "rmse_dx": 0.019318532198667526,
      "rmse_dy": 0.00792232807725668,
      "rmse_mean": 0.02458837255835533,
      "rotation_flip": 0.004115226212888956,
      "sparse_tokens": 18348.0,
      "step": 8075,
      "turn_loss": 0.20474450290203094,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.3752090689462925,
      "grad_norm": 0.3631606698036194,
      "learning_rate": 2.460030015108682e-06,
      "loss": 0.1136,
      "mae_dtheta": 0.026492981240153313,
      "mae_dx": 0.009552303701639175,
      "mae_dy": 0.0037614195607602596,
      "pose_mae_dtheta": 0.1807001531124115,
      "pose_mae_dx": 0.07724396139383316,
      "pose_mae_dy": 0.046314459294080734,
      "pose_rmse_dtheta": 0.3140561878681183,
      "pose_rmse_dx": 0.16408927738666534,
      "pose_rmse_dy": 0.11405763775110245,
      "pose_rmse_mean": 0.1974010467529297,
      "rmse_dtheta": 0.042185742408037186,
      "rmse_dx": 0.020534630864858627,
      "rmse_dy": 0.007417459972202778,
      "rmse_mean": 0.023379279300570488,
      "rotation_flip": 0.02167630009353161,
      "sparse_tokens": 13398.0,
      "step": 8076,
      "turn_loss": 0.21031218767166138,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3752555287121353,
      "grad_norm": 0.5275440216064453,
      "learning_rate": 2.4588911964571557e-06,
      "loss": 0.0721,
      "mae_dtheta": 0.006708402186632156,
      "mae_dx": 0.001107537536881864,
      "mae_dy": 0.0005001597455702722,
      "pose_mae_dtheta": 0.04930974170565605,
      "pose_mae_dx": 0.008503290824592113,
      "pose_mae_dy": 0.00742997694760561,
      "pose_rmse_dtheta": 0.21274279057979584,
      "pose_rmse_dx": 0.029362961649894714,
      "pose_rmse_dy": 0.021003717556595802,
      "pose_rmse_mean": 0.0877031609416008,
      "rmse_dtheta": 0.024917343631386757,
      "rmse_dx": 0.004467014688998461,
      "rmse_dy": 0.0015968662919476628,
      "rmse_mean": 0.01032707467675209,
      "rotation_flip": 0.001369863050058484,
      "sparse_tokens": 32153.0,
      "step": 8077,
      "turn_loss": 0.0406828373670578,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3753019884779781,
      "grad_norm": 0.5076091885566711,
      "learning_rate": 2.4577525555067294e-06,
      "loss": 0.1321,
      "mae_dtheta": 0.006696345750242472,
      "mae_dx": 0.0010636321967467666,
      "mae_dy": 0.0014621622394770384,
      "pose_mae_dtheta": 0.047060783952474594,
      "pose_mae_dx": 0.013349427841603756,
      "pose_mae_dy": 0.018572909757494926,
      "pose_rmse_dtheta": 0.1405116319656372,
      "pose_rmse_dx": 0.03463935852050781,
      "pose_rmse_dy": 0.04375382140278816,
      "pose_rmse_mean": 0.07296827435493469,
      "rmse_dtheta": 0.017465172335505486,
      "rmse_dx": 0.0034027209039777517,
      "rmse_dy": 0.003218409838154912,
      "rmse_mean": 0.008028768002986908,
      "rotation_flip": 0.007156488485634327,
      "sparse_tokens": 32073.0,
      "step": 8078,
      "turn_loss": 0.056050535291433334,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.37534844824382085,
      "grad_norm": 0.7480856776237488,
      "learning_rate": 2.456614092337034e-06,
      "loss": 0.1661,
      "mae_dtheta": 0.037276942282915115,
      "mae_dx": 0.012327807024121284,
      "mae_dy": 0.005692444276064634,
      "pose_mae_dtheta": 0.28718942403793335,
      "pose_mae_dx": 0.08639298379421234,
      "pose_mae_dy": 0.07549680024385452,
      "pose_rmse_dtheta": 0.48827722668647766,
      "pose_rmse_dx": 0.19985440373420715,
      "pose_rmse_dy": 0.1741991937160492,
      "pose_rmse_mean": 0.287443608045578,
      "rmse_dtheta": 0.055588919669389725,
      "rmse_dx": 0.02467321790754795,
      "rmse_dy": 0.011469540186226368,
      "rmse_mean": 0.030577227473258972,
      "rotation_flip": 0.01056338008493185,
      "sparse_tokens": 8990.0,
      "step": 8079,
      "turn_loss": 0.30245131254196167,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.37539490800966363,
      "grad_norm": 0.35110291838645935,
      "learning_rate": 2.4554758070276785e-06,
      "loss": 0.1129,
      "mae_dtheta": 0.01017693430185318,
      "mae_dx": 0.001328212907537818,
      "mae_dy": 0.0017155209789052606,
      "pose_mae_dtheta": 0.06560824066400528,
      "pose_mae_dx": 0.01531895436346531,
      "pose_mae_dy": 0.022193605080246925,
      "pose_rmse_dtheta": 0.18096964061260223,
      "pose_rmse_dx": 0.03538886830210686,
      "pose_rmse_dy": 0.049300454556941986,
      "pose_rmse_mean": 0.08855299651622772,
      "rmse_dtheta": 0.022255832329392433,
      "rmse_dx": 0.004214417655020952,
      "rmse_dy": 0.0032732300460338593,
      "rmse_mean": 0.009914493188261986,
      "rotation_flip": 0.0031250000465661287,
      "sparse_tokens": 32105.0,
      "step": 8080,
      "turn_loss": 0.07260259240865707,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3754413677755064,
      "grad_norm": 0.36332985758781433,
      "learning_rate": 2.454337699658267e-06,
      "loss": 0.0914,
      "mae_dtheta": 0.012381713837385178,
      "mae_dx": 0.0013570110313594341,
      "mae_dy": 0.0024104074109345675,
      "pose_mae_dtheta": 0.0828888937830925,
      "pose_mae_dx": 0.02067895233631134,
      "pose_mae_dy": 0.03077118471264839,
      "pose_rmse_dtheta": 0.21841566264629364,
      "pose_rmse_dx": 0.05545332282781601,
      "pose_rmse_dy": 0.06878126412630081,
      "pose_rmse_mean": 0.11421674489974976,
      "rmse_dtheta": 0.025766463950276375,
      "rmse_dx": 0.004261798691004515,
      "rmse_dy": 0.005020476412028074,
      "rmse_mean": 0.011682912707328796,
      "rotation_flip": 0.0034978624898940325,
      "sparse_tokens": 32057.0,
      "step": 8081,
      "turn_loss": 0.09054558724164963,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3754878275413492,
      "grad_norm": 0.43680858612060547,
      "learning_rate": 2.4531997703083847e-06,
      "loss": 0.0808,
      "mae_dtheta": 0.011874968186020851,
      "mae_dx": 0.001392377889715135,
      "mae_dy": 0.002437392482534051,
      "pose_mae_dtheta": 0.07702942192554474,
      "pose_mae_dx": 0.02297915890812874,
      "pose_mae_dy": 0.027284719049930573,
      "pose_rmse_dtheta": 0.23838797211647034,
      "pose_rmse_dx": 0.06669742614030838,
      "pose_rmse_dy": 0.07177570462226868,
      "pose_rmse_mean": 0.12562036514282227,
      "rmse_dtheta": 0.028151830658316612,
      "rmse_dx": 0.004111083690077066,
      "rmse_dy": 0.005878889001905918,
      "rmse_mean": 0.012713934294879436,
      "rotation_flip": 0.00551782688125968,
      "sparse_tokens": 32057.0,
      "step": 8082,
      "turn_loss": 0.07219665497541428,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.37553428730719196,
      "grad_norm": 0.48701438307762146,
      "learning_rate": 2.4520620190576094e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.011854404583573341,
      "mae_dx": 0.002091820817440748,
      "mae_dy": 0.0029168040491640568,
      "pose_mae_dtheta": 0.08549851924180984,
      "pose_mae_dx": 0.019726162776350975,
      "pose_mae_dy": 0.029008597135543823,
      "pose_rmse_dtheta": 0.2432388961315155,
      "pose_rmse_dx": 0.0629550963640213,
      "pose_rmse_dy": 0.07752209156751633,
      "pose_rmse_mean": 0.12790536880493164,
      "rmse_dtheta": 0.02764246053993702,
      "rmse_dx": 0.007609338499605656,
      "rmse_dy": 0.008423753082752228,
      "rmse_mean": 0.014558518305420876,
      "rotation_flip": 0.006768189370632172,
      "sparse_tokens": 32073.0,
      "step": 8083,
      "turn_loss": 0.09366603940725327,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.37558074707303474,
      "grad_norm": 0.736699640750885,
      "learning_rate": 2.4509244459855065e-06,
      "loss": 0.1784,
      "mae_dtheta": 0.032271772623062134,
      "mae_dx": 0.011372258886694908,
      "mae_dy": 0.004502993542701006,
      "pose_mae_dtheta": 0.23960444331169128,
      "pose_mae_dx": 0.09748063236474991,
      "pose_mae_dy": 0.046825312077999115,
      "pose_rmse_dtheta": 0.39816492795944214,
      "pose_rmse_dx": 0.23666897416114807,
      "pose_rmse_dy": 0.11029177904129028,
      "pose_rmse_mean": 0.24837523698806763,
      "rmse_dtheta": 0.04691421240568161,
      "rmse_dx": 0.024046851322054863,
      "rmse_dy": 0.01080374140292406,
      "rmse_mean": 0.02725493721663952,
      "rotation_flip": 0.018789144232869148,
      "sparse_tokens": 15645.0,
      "step": 8084,
      "turn_loss": 0.26439255475997925,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.3756272068388775,
      "grad_norm": 0.33851179480552673,
      "learning_rate": 2.4497870511716237e-06,
      "loss": 0.0771,
      "mae_dtheta": 0.023841777816414833,
      "mae_dx": 0.005184696987271309,
      "mae_dy": 0.004734213463962078,
      "pose_mae_dtheta": 0.17559289932250977,
      "pose_mae_dx": 0.03777904808521271,
      "pose_mae_dy": 0.061823707073926926,
      "pose_rmse_dtheta": 0.3389231264591217,
      "pose_rmse_dx": 0.07966910302639008,
      "pose_rmse_dy": 0.14095796644687653,
      "pose_rmse_mean": 0.18651673197746277,
      "rmse_dtheta": 0.03944770246744156,
      "rmse_dx": 0.013699236325919628,
      "rmse_dy": 0.008089284412562847,
      "rmse_mean": 0.020412076264619827,
      "rotation_flip": 0.004987531341612339,
      "sparse_tokens": 6844.0,
      "step": 8085,
      "turn_loss": 0.20889952778816223,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.3756736666047203,
      "grad_norm": 0.3963800370693207,
      "learning_rate": 2.448649834695503e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.028412437066435814,
      "mae_dx": 0.006941199768334627,
      "mae_dy": 0.00471118651330471,
      "pose_mae_dtheta": 0.23447862267494202,
      "pose_mae_dx": 0.07862378656864166,
      "pose_mae_dy": 0.08099775016307831,
      "pose_rmse_dtheta": 0.3891114890575409,
      "pose_rmse_dx": 0.21534466743469238,
      "pose_rmse_dy": 0.17055298388004303,
      "pose_rmse_mean": 0.2583363950252533,
      "rmse_dtheta": 0.04332499951124191,
      "rmse_dx": 0.018818648532032967,
      "rmse_dy": 0.00831011775881052,
      "rmse_mean": 0.02348458766937256,
      "rotation_flip": 0.013245033100247383,
      "sparse_tokens": 5414.0,
      "step": 8086,
      "turn_loss": 0.20783762633800507,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.37572012637056307,
      "grad_norm": 0.3963559567928314,
      "learning_rate": 2.4475127966366665e-06,
      "loss": 0.111,
      "mae_dtheta": 0.03243343532085419,
      "mae_dx": 0.010684285312891006,
      "mae_dy": 0.004148572217673063,
      "pose_mae_dtheta": 0.24287378787994385,
      "pose_mae_dx": 0.07842598855495453,
      "pose_mae_dy": 0.04338910058140755,
      "pose_rmse_dtheta": 0.43529704213142395,
      "pose_rmse_dx": 0.17951767146587372,
      "pose_rmse_dy": 0.10372405499219894,
      "pose_rmse_mean": 0.23951292037963867,
      "rmse_dtheta": 0.0509210079908371,
      "rmse_dx": 0.022282235324382782,
      "rmse_dy": 0.00850948877632618,
      "rmse_mean": 0.027237577363848686,
      "rotation_flip": 0.015670910477638245,
      "sparse_tokens": 16806.0,
      "step": 8087,
      "turn_loss": 0.2555789351463318,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.3757665861364059,
      "grad_norm": 0.500778079032898,
      "learning_rate": 2.4463759370746302e-06,
      "loss": 0.1388,
      "mae_dtheta": 0.029725627973675728,
      "mae_dx": 0.009808709844946861,
      "mae_dy": 0.007656944449990988,
      "pose_mae_dtheta": 0.2462664097547531,
      "pose_mae_dx": 0.08303537964820862,
      "pose_mae_dy": 0.06511425971984863,
      "pose_rmse_dtheta": 0.4341914653778076,
      "pose_rmse_dx": 0.19148483872413635,
      "pose_rmse_dy": 0.13648417592048645,
      "pose_rmse_mean": 0.2540534734725952,
      "rmse_dtheta": 0.046056438237428665,
      "rmse_dx": 0.020839720964431763,
      "rmse_dy": 0.015123206190764904,
      "rmse_mean": 0.027339786291122437,
      "rotation_flip": 0.011034483090043068,
      "sparse_tokens": 11905.0,
      "step": 8088,
      "turn_loss": 0.29335758090019226,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.3758130459022487,
      "grad_norm": 0.7035221457481384,
      "learning_rate": 2.445239256088898e-06,
      "loss": 0.1397,
      "mae_dtheta": 0.018158340826630592,
      "mae_dx": 0.006333466153591871,
      "mae_dy": 0.002259212313219905,
      "pose_mae_dtheta": 0.12076571583747864,
      "pose_mae_dx": 0.06527973711490631,
      "pose_mae_dy": 0.02829604782164097,
      "pose_rmse_dtheta": 0.20226775109767914,
      "pose_rmse_dx": 0.12335938215255737,
      "pose_rmse_dy": 0.06930705904960632,
      "pose_rmse_mean": 0.13164474070072174,
      "rmse_dtheta": 0.03236151114106178,
      "rmse_dx": 0.014515128917992115,
      "rmse_dy": 0.004376701079308987,
      "rmse_mean": 0.017084447667002678,
      "rotation_flip": 0.0,
      "sparse_tokens": 4105.0,
      "step": 8089,
      "turn_loss": 0.17298263311386108,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.37585950566809145,
      "grad_norm": 0.49514681100845337,
      "learning_rate": 2.4441027537589527e-06,
      "loss": 0.0834,
      "mae_dtheta": 0.03460406884551048,
      "mae_dx": 0.01795017719268799,
      "mae_dy": 0.005143118090927601,
      "pose_mae_dtheta": 0.27999070286750793,
      "pose_mae_dx": 0.1350031942129135,
      "pose_mae_dy": 0.0623152069747448,
      "pose_rmse_dtheta": 0.4605230391025543,
      "pose_rmse_dx": 0.2572014331817627,
      "pose_rmse_dy": 0.15105466544628143,
      "pose_rmse_mean": 0.28959304094314575,
      "rmse_dtheta": 0.04870827868580818,
      "rmse_dx": 0.03071816824376583,
      "rmse_dy": 0.00962257944047451,
      "rmse_mean": 0.029683008790016174,
      "rotation_flip": 0.021653544157743454,
      "sparse_tokens": 8075.0,
      "step": 8090,
      "turn_loss": 0.320249080657959,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.37590596543393423,
      "grad_norm": 0.5025648474693298,
      "learning_rate": 2.4429664301642763e-06,
      "loss": 0.117,
      "mae_dtheta": 0.013769637793302536,
      "mae_dx": 0.001625323435291648,
      "mae_dy": 0.0032231591176241636,
      "pose_mae_dtheta": 0.09282626956701279,
      "pose_mae_dx": 0.026690857484936714,
      "pose_mae_dy": 0.03873208910226822,
      "pose_rmse_dtheta": 0.229678675532341,
      "pose_rmse_dx": 0.06696028262376785,
      "pose_rmse_dy": 0.07820264995098114,
      "pose_rmse_mean": 0.1249472126364708,
      "rmse_dtheta": 0.026543935760855675,
      "rmse_dx": 0.004455823916941881,
      "rmse_dy": 0.00620478019118309,
      "rmse_mean": 0.012401513755321503,
      "rotation_flip": 0.006981383077800274,
      "sparse_tokens": 32073.0,
      "step": 8091,
      "turn_loss": 0.1135682761669159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.375952425199777,
      "grad_norm": 0.4866209030151367,
      "learning_rate": 2.4418302853843278e-06,
      "loss": 0.1068,
      "mae_dtheta": 0.007937219925224781,
      "mae_dx": 0.0014672253746539354,
      "mae_dy": 0.001201236736960709,
      "pose_mae_dtheta": 0.05587925761938095,
      "pose_mae_dx": 0.01589258760213852,
      "pose_mae_dy": 0.015978055074810982,
      "pose_rmse_dtheta": 0.19948673248291016,
      "pose_rmse_dx": 0.03944757580757141,
      "pose_rmse_dy": 0.047534409910440445,
      "pose_rmse_mean": 0.09548957645893097,
      "rmse_dtheta": 0.023654842749238014,
      "rmse_dx": 0.004163626115769148,
      "rmse_dy": 0.003050761530175805,
      "rmse_mean": 0.010289743542671204,
      "rotation_flip": 0.0027764923870563507,
      "sparse_tokens": 32169.0,
      "step": 8092,
      "turn_loss": 0.05974011868238449,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3759988849656198,
      "grad_norm": 0.3234887719154358,
      "learning_rate": 2.4406943194985623e-06,
      "loss": 0.0716,
      "mae_dtheta": 0.008648793213069439,
      "mae_dx": 0.0012612458085641265,
      "mae_dy": 0.0013917699689045548,
      "pose_mae_dtheta": 0.05893198400735855,
      "pose_mae_dx": 0.011544863693416119,
      "pose_mae_dy": 0.015318253077566624,
      "pose_rmse_dtheta": 0.1977202296257019,
      "pose_rmse_dx": 0.03179953247308731,
      "pose_rmse_dy": 0.04666052386164665,
      "pose_rmse_mean": 0.09206008911132812,
      "rmse_dtheta": 0.023716866970062256,
      "rmse_dx": 0.004128947854042053,
      "rmse_dy": 0.003942309878766537,
      "rmse_mean": 0.01059604249894619,
      "rotation_flip": 0.007793473079800606,
      "sparse_tokens": 32105.0,
      "step": 8093,
      "turn_loss": 0.06430235505104065,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.37604534473146256,
      "grad_norm": 0.3399827182292938,
      "learning_rate": 2.439558532586415e-06,
      "loss": 0.0835,
      "mae_dtheta": 0.007991738617420197,
      "mae_dx": 0.001167302136309445,
      "mae_dy": 0.002675179624930024,
      "pose_mae_dtheta": 0.05072930455207825,
      "pose_mae_dx": 0.01931973360478878,
      "pose_mae_dy": 0.02955930121243,
      "pose_rmse_dtheta": 0.1149885505437851,
      "pose_rmse_dx": 0.04969301447272301,
      "pose_rmse_dy": 0.06428337097167969,
      "pose_rmse_mean": 0.07632164657115936,
      "rmse_dtheta": 0.01781579852104187,
      "rmse_dx": 0.003255886025726795,
      "rmse_dy": 0.005789345130324364,
      "rmse_mean": 0.00895367655903101,
      "rotation_flip": 0.0012520868331193924,
      "sparse_tokens": 32057.0,
      "step": 8094,
      "turn_loss": 0.06897938251495361,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.37609180449730534,
      "grad_norm": 0.556850016117096,
      "learning_rate": 2.4384229247273154e-06,
      "loss": 0.1546,
      "mae_dtheta": 0.007583296857774258,
      "mae_dx": 0.001404968905262649,
      "mae_dy": 0.0013985373079776764,
      "pose_mae_dtheta": 0.05195891857147217,
      "pose_mae_dx": 0.015182645991444588,
      "pose_mae_dy": 0.01948324218392372,
      "pose_rmse_dtheta": 0.11625101417303085,
      "pose_rmse_dx": 0.041988104581832886,
      "pose_rmse_dy": 0.04322692006826401,
      "pose_rmse_mean": 0.06715535372495651,
      "rmse_dtheta": 0.016043387353420258,
      "rmse_dx": 0.0049455915577709675,
      "rmse_dy": 0.0031644627451896667,
      "rmse_mean": 0.008051147684454918,
      "rotation_flip": 0.004205214325338602,
      "sparse_tokens": 32105.0,
      "step": 8095,
      "turn_loss": 0.06893184036016464,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3761382642631481,
      "grad_norm": 0.751068651676178,
      "learning_rate": 2.437287496000674e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.01152757741510868,
      "mae_dx": 0.00367666594684124,
      "mae_dy": 0.00558529794216156,
      "pose_mae_dtheta": 0.07480079680681229,
      "pose_mae_dx": 0.043720610439777374,
      "pose_mae_dy": 0.037955183535814285,
      "pose_rmse_dtheta": 0.14281265437602997,
      "pose_rmse_dx": 0.12075767666101456,
      "pose_rmse_dy": 0.07422628998756409,
      "pose_rmse_mean": 0.11259888112545013,
      "rmse_dtheta": 0.021016472950577736,
      "rmse_dx": 0.009250558912754059,
      "rmse_dy": 0.012221256271004677,
      "rmse_mean": 0.014162763021886349,
      "rotation_flip": 0.008173529990017414,
      "sparse_tokens": 32105.0,
      "step": 8096,
      "turn_loss": 0.14502522349357605,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.3761847240289909,
      "grad_norm": 0.4443066716194153,
      "learning_rate": 2.4361522464858956e-06,
      "loss": 0.0993,
      "mae_dtheta": 0.0279562845826149,
      "mae_dx": 0.009394573979079723,
      "mae_dy": 0.0022669779136776924,
      "pose_mae_dtheta": 0.231172114610672,
      "pose_mae_dx": 0.0835479274392128,
      "pose_mae_dy": 0.029204780235886574,
      "pose_rmse_dtheta": 0.447327196598053,
      "pose_rmse_dx": 0.1993681639432907,
      "pose_rmse_dy": 0.07198836654424667,
      "pose_rmse_mean": 0.23956124484539032,
      "rmse_dtheta": 0.047322358936071396,
      "rmse_dx": 0.020989399403333664,
      "rmse_dy": 0.005153858568519354,
      "rmse_mean": 0.02448853850364685,
      "rotation_flip": 0.01575532928109169,
      "sparse_tokens": 20653.0,
      "step": 8097,
      "turn_loss": 0.19804780185222626,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.37623118379483367,
      "grad_norm": 0.44141456484794617,
      "learning_rate": 2.4350171762623642e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.007696008309721947,
      "mae_dx": 0.0015965800266712904,
      "mae_dy": 0.0015451268991455436,
      "pose_mae_dtheta": 0.04892244562506676,
      "pose_mae_dx": 0.012969779781997204,
      "pose_mae_dy": 0.01615520752966404,
      "pose_rmse_dtheta": 0.16119080781936646,
      "pose_rmse_dx": 0.03701646625995636,
      "pose_rmse_dy": 0.03760303556919098,
      "pose_rmse_mean": 0.07860343903303146,
      "rmse_dtheta": 0.020466823130846024,
      "rmse_dx": 0.006270076148211956,
      "rmse_dy": 0.004769479855895042,
      "rmse_mean": 0.010502127930521965,
      "rotation_flip": 0.004041311331093311,
      "sparse_tokens": 32089.0,
      "step": 8098,
      "turn_loss": 0.06392009556293488,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.37627764356067644,
      "grad_norm": 0.5305230021476746,
      "learning_rate": 2.4338822854094605e-06,
      "loss": 0.1129,
      "mae_dtheta": 0.03106182999908924,
      "mae_dx": 0.009488844312727451,
      "mae_dy": 0.0070454711094498634,
      "pose_mae_dtheta": 0.24561752378940582,
      "pose_mae_dx": 0.09834455698728561,
      "pose_mae_dy": 0.10223891586065292,
      "pose_rmse_dtheta": 0.4155822694301605,
      "pose_rmse_dx": 0.21640029549598694,
      "pose_rmse_dy": 0.21607260406017303,
      "pose_rmse_mean": 0.2826850712299347,
      "rmse_dtheta": 0.047501467168331146,
      "rmse_dx": 0.021390296518802643,
      "rmse_dy": 0.013974935747683048,
      "rmse_mean": 0.02762223407626152,
      "rotation_flip": 0.009372071363031864,
      "sparse_tokens": 19861.0,
      "step": 8099,
      "turn_loss": 0.262054443359375,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3763241033265192,
      "grad_norm": 0.46567270159721375,
      "learning_rate": 2.432747574006544e-06,
      "loss": 0.1241,
      "mae_dtheta": 0.012297882698476315,
      "mae_dx": 0.00210908823646605,
      "mae_dy": 0.0031467669177800417,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4656727910041809,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 166.99000549316406,
      "model/head/act_norm_mean": 103.15236347853535,
      "model/head/act_norm_min": 52.58709716796875,
      "model/head/act_over_embed": 70.88726991009166,
      "model/head/grad_frac": 0.09479827433824539,
      "model/head/grad_norm": 0.04414497688412666,
      "model/head/grad_zero_frac": 0.00020210212096571922,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7080522017045454,
      "model/head/update_ratio": 0.0007521219085901976,
      "model/head/weight_delta": 9.701823234558105,
      "model/head/weight_delta_rel": 0.1701987087726593,
      "model/head/weight_norm": 58.693912506103516,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42233893275260925,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42226070827907985,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42218464612960815,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29018151199641934,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09671581536531448,
      "model/modality_embedder.encoders.pose/grad_norm": 0.045037925243377686,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5356857638888889,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014544468140229583,
      "model/modality_embedder.encoders.pose/weight_delta": 3.102325677871704,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10136264562606812,
      "model/modality_embedder.encoders.pose/weight_norm": 30.965673446655273,
      "model/modality_embedder/grad_frac": 0.09671581536531448,
      "model/modality_embedder/grad_norm": 0.045037925243377686,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5356857638888889,
      "model/modality_embedder/update_ratio": 0.0014544468140229583,
      "model/modality_embedder/weight_delta": 3.102325677871704,
      "model/modality_embedder/weight_delta_rel": 0.10136264562606812,
      "model/modality_embedder/weight_norm": 30.965673446655273,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.83267974853516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.997201679493347,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.012423515319824,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.80389229734211,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05697217583656311,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.026530392467975616,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003429632051847875,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009498695726506412,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.602952718734741,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09485317021608353,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.93056297302246,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.33668518066406,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.986281465448133,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.10401439666748,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.483597186161088,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05656496435403824,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02634076401591301,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008862910326570272,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3000645637512207,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11431681364774704,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.720218658447266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.1689453125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.835790945165947,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.008931159973145,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.754597416003726,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05867071449756622,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.027321355417370796,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008902784902602434,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.567838191986084,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11980132758617401,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.688549041748047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.90110778808594,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.655861692320027,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.962924003601074,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.00536707321881,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.066938117146492,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03117126040160656,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001042059506289661,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0573694705963135,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1044863760471344,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.913127899169922,
      "model/normalizer/grad_frac": 0.2534233331680298,
      "model/normalizer/grad_norm": 0.11801235377788544,
      "model/normalizer/grad_zero_frac": 0.0002540737623348832,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0015014036325737834,
      "model/normalizer/weight_delta": 6.450921535491943,
      "model/normalizer/weight_delta_rel": 0.08308413624763489,
      "model/normalizer/weight_norm": 78.60134887695312,
      "pose_mae_dtheta": 0.08061841875314713,
      "pose_mae_dx": 0.023203037679195404,
      "pose_mae_dy": 0.026182202622294426,
      "pose_rmse_dtheta": 0.2131384015083313,
      "pose_rmse_dx": 0.060414791107177734,
      "pose_rmse_dy": 0.05689173936843872,
      "pose_rmse_mean": 0.11014831066131592,
      "rmse_dtheta": 0.0277169831097126,
      "rmse_dx": 0.005732818506658077,
      "rmse_dy": 0.007076020818203688,
      "rmse_mean": 0.013508608564734459,
      "rotation_flip": 0.005999249871820211,
      "sparse_tokens": 32121.0,
      "step": 8100,
      "turn_loss": 0.11533170938491821,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.376370563092362,
      "grad_norm": 0.8208848834037781,
      "learning_rate": 2.4316130421329696e-06,
      "loss": 0.2757,
      "mae_dtheta": 0.033704351633787155,
      "mae_dx": 0.012521564029157162,
      "mae_dy": 0.003518810961395502,
      "pose_mae_dtheta": 0.2903152108192444,
      "pose_mae_dx": 0.09357485920190811,
      "pose_mae_dy": 0.046981241554021835,
      "pose_rmse_dtheta": 0.470723032951355,
      "pose_rmse_dx": 0.2240634560585022,
      "pose_rmse_dy": 0.11927813291549683,
      "pose_rmse_mean": 0.27135488390922546,
      "rmse_dtheta": 0.051553260535001755,
      "rmse_dx": 0.025272391736507416,
      "rmse_dy": 0.0071288361214101315,
      "rmse_mean": 0.027984827756881714,
      "rotation_flip": 0.02075471729040146,
      "sparse_tokens": 9440.0,
      "step": 8101,
      "turn_loss": 0.2834920585155487,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3764170228582048,
      "grad_norm": 0.49992117285728455,
      "learning_rate": 2.4304786898680715e-06,
      "loss": 0.1,
      "mae_dtheta": 0.007422001101076603,
      "mae_dx": 0.0011725397780537605,
      "mae_dy": 0.0002139563875971362,
      "pose_mae_dtheta": 0.05069189518690109,
      "pose_mae_dx": 0.008761915378272533,
      "pose_mae_dy": 0.0026463493704795837,
      "pose_rmse_dtheta": 0.24569851160049438,
      "pose_rmse_dx": 0.02961396984755993,
      "pose_rmse_dy": 0.0049768900498747826,
      "pose_rmse_mean": 0.093429796397686,
      "rmse_dtheta": 0.030094988644123077,
      "rmse_dx": 0.003693563863635063,
      "rmse_dy": 0.0005332871223799884,
      "rmse_mean": 0.011440614238381386,
      "rotation_flip": 0.001299545168876648,
      "sparse_tokens": 32201.0,
      "step": 8102,
      "turn_loss": 0.041580721735954285,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.37646348262404755,
      "grad_norm": 0.46492505073547363,
      "learning_rate": 2.42934451729118e-06,
      "loss": 0.103,
      "mae_dtheta": 0.010427763685584068,
      "mae_dx": 0.0016885476652532816,
      "mae_dy": 0.002611383330076933,
      "pose_mae_dtheta": 0.07043500989675522,
      "pose_mae_dx": 0.01982921175658703,
      "pose_mae_dy": 0.026685195043683052,
      "pose_rmse_dtheta": 0.1704922616481781,
      "pose_rmse_dx": 0.05663776770234108,
      "pose_rmse_dy": 0.06645651161670685,
      "pose_rmse_mean": 0.09786218404769897,
      "rmse_dtheta": 0.02327628619968891,
      "rmse_dx": 0.0056897313334047794,
      "rmse_dy": 0.0066283270716667175,
      "rmse_mean": 0.011864781379699707,
      "rotation_flip": 0.00783828366547823,
      "sparse_tokens": 32057.0,
      "step": 8103,
      "turn_loss": 0.09309845417737961,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.37650994238989033,
      "grad_norm": 0.4509231746196747,
      "learning_rate": 2.4282105244816047e-06,
      "loss": 0.0913,
      "mae_dtheta": 0.01157858595252037,
      "mae_dx": 0.0011738104512915015,
      "mae_dy": 0.0018972618272528052,
      "pose_mae_dtheta": 0.07301472872495651,
      "pose_mae_dx": 0.014144803397357464,
      "pose_mae_dy": 0.024369696155190468,
      "pose_rmse_dtheta": 0.20427438616752625,
      "pose_rmse_dx": 0.03104322962462902,
      "pose_rmse_dy": 0.04852626100182533,
      "pose_rmse_mean": 0.09461462497711182,
      "rmse_dtheta": 0.02732914872467518,
      "rmse_dx": 0.0034187540877610445,
      "rmse_dy": 0.003586419625207782,
      "rmse_mean": 0.011444775387644768,
      "rotation_flip": 0.007062146905809641,
      "sparse_tokens": 32105.0,
      "step": 8104,
      "turn_loss": 0.07840794324874878,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.37655640215573316,
      "grad_norm": 0.509043276309967,
      "learning_rate": 2.4270767115186488e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.00826779194176197,
      "mae_dx": 0.0013202701229602098,
      "mae_dy": 0.0019473903812468052,
      "pose_mae_dtheta": 0.04875214025378227,
      "pose_mae_dx": 0.01816251501441002,
      "pose_mae_dy": 0.020149488002061844,
      "pose_rmse_dtheta": 0.1345197707414627,
      "pose_rmse_dx": 0.0501861646771431,
      "pose_rmse_dy": 0.05139422416687012,
      "pose_rmse_mean": 0.07870005816221237,
      "rmse_dtheta": 0.021375861018896103,
      "rmse_dx": 0.0036330092698335648,
      "rmse_dy": 0.00462842732667923,
      "rmse_mean": 0.0098790992051363,
      "rotation_flip": 0.004168596584349871,
      "sparse_tokens": 32073.0,
      "step": 8105,
      "turn_loss": 0.06440907716751099,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.37660286192157594,
      "grad_norm": 0.5219690799713135,
      "learning_rate": 2.425943078481598e-06,
      "loss": 0.0818,
      "mae_dtheta": 0.012343314476311207,
      "mae_dx": 0.0015145648503676057,
      "mae_dy": 0.0027707270346581936,
      "pose_mae_dtheta": 0.0821235254406929,
      "pose_mae_dx": 0.023983273655176163,
      "pose_mae_dy": 0.03336101025342941,
      "pose_rmse_dtheta": 0.19961492717266083,
      "pose_rmse_dx": 0.05831609666347504,
      "pose_rmse_dy": 0.07875816524028778,
      "pose_rmse_mean": 0.11222972720861435,
      "rmse_dtheta": 0.02472613751888275,
      "rmse_dx": 0.004493802320212126,
      "rmse_dy": 0.005793222691863775,
      "rmse_mean": 0.011671054176986217,
      "rotation_flip": 0.005490955896675587,
      "sparse_tokens": 32121.0,
      "step": 8106,
      "turn_loss": 0.09103593975305557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32763.0,
      "epoch": 0.3766493216874187,
      "grad_norm": 0.7060366868972778,
      "learning_rate": 2.424809625449729e-06,
      "loss": 0.125,
      "mae_dtheta": 0.02782834693789482,
      "mae_dx": 0.00868706963956356,
      "mae_dy": 0.00630232086405158,
      "pose_mae_dtheta": 0.19782474637031555,
      "pose_mae_dx": 0.06481994688510895,
      "pose_mae_dy": 0.05632685869932175,
      "pose_rmse_dtheta": 0.35744208097457886,
      "pose_rmse_dx": 0.1450306475162506,
      "pose_rmse_dy": 0.14038801193237305,
      "pose_rmse_mean": 0.2142869234085083,
      "rmse_dtheta": 0.043235134333372116,
      "rmse_dx": 0.019192326813936234,
      "rmse_dy": 0.012283273972570896,
      "rmse_mean": 0.02490357868373394,
      "rotation_flip": 0.009026434272527695,
      "sparse_tokens": 25054.0,
      "step": 8107,
      "turn_loss": 0.2655871510505676,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3766957814532615,
      "grad_norm": 0.5788419246673584,
      "learning_rate": 2.423676352502307e-06,
      "loss": 0.0946,
      "mae_dtheta": 0.007261968217790127,
      "mae_dx": 0.0010929511627182364,
      "mae_dy": 0.0017425190890207887,
      "pose_mae_dtheta": 0.05104619637131691,
      "pose_mae_dx": 0.016721343621611595,
      "pose_mae_dy": 0.02296529896557331,
      "pose_rmse_dtheta": 0.15929637849330902,
      "pose_rmse_dx": 0.06078391894698143,
      "pose_rmse_dy": 0.07341834157705307,
      "pose_rmse_mean": 0.09783288091421127,
      "rmse_dtheta": 0.019737878814339638,
      "rmse_dx": 0.0034991672728210688,
      "rmse_dy": 0.004998154006898403,
      "rmse_mean": 0.009411733597517014,
      "rotation_flip": 0.005196304991841316,
      "sparse_tokens": 32057.0,
      "step": 8108,
      "turn_loss": 0.06173010542988777,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.37674224121910427,
      "grad_norm": 0.4024581015110016,
      "learning_rate": 2.4225432597185787e-06,
      "loss": 0.0948,
      "mae_dtheta": 0.023411694914102554,
      "mae_dx": 0.007363521959632635,
      "mae_dy": 0.003802650375291705,
      "pose_mae_dtheta": 0.1791614443063736,
      "pose_mae_dx": 0.07326307147741318,
      "pose_mae_dy": 0.05026432126760483,
      "pose_rmse_dtheta": 0.2973826825618744,
      "pose_rmse_dx": 0.15634886920452118,
      "pose_rmse_dy": 0.10849065333604813,
      "pose_rmse_mean": 0.18740740418434143,
      "rmse_dtheta": 0.03679046407341957,
      "rmse_dx": 0.016728591173887253,
      "rmse_dy": 0.0064426022581756115,
      "rmse_mean": 0.01998721994459629,
      "rotation_flip": 0.015306122601032257,
      "sparse_tokens": 8378.0,
      "step": 8109,
      "turn_loss": 0.18144632875919342,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.37678870098494704,
      "grad_norm": 0.766085147857666,
      "learning_rate": 2.421410347177786e-06,
      "loss": 0.1554,
      "mae_dtheta": 0.03602465242147446,
      "mae_dx": 0.010107951238751411,
      "mae_dy": 0.007354326080530882,
      "pose_mae_dtheta": 0.27751386165618896,
      "pose_mae_dx": 0.08781375735998154,
      "pose_mae_dy": 0.06371185183525085,
      "pose_rmse_dtheta": 0.506118893623352,
      "pose_rmse_dx": 0.20556385815143585,
      "pose_rmse_dy": 0.1521301120519638,
      "pose_rmse_mean": 0.28793764114379883,
      "rmse_dtheta": 0.0578186921775341,
      "rmse_dx": 0.020989956334233284,
      "rmse_dy": 0.016127293929457664,
      "rmse_mean": 0.03164531663060188,
      "rotation_flip": 0.01923076994717121,
      "sparse_tokens": 23961.0,
      "step": 8110,
      "turn_loss": 0.33849823474884033,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.3768351607507898,
      "grad_norm": 0.3851400315761566,
      "learning_rate": 2.4202776149591494e-06,
      "loss": 0.0881,
      "mae_dtheta": 0.025909004732966423,
      "mae_dx": 0.012248222716152668,
      "mae_dy": 0.005128053016960621,
      "pose_mae_dtheta": 0.2054445743560791,
      "pose_mae_dx": 0.11729968339204788,
      "pose_mae_dy": 0.07074581831693649,
      "pose_rmse_dtheta": 0.3397811949253082,
      "pose_rmse_dx": 0.2863893508911133,
      "pose_rmse_dy": 0.14753496646881104,
      "pose_rmse_mean": 0.2579018473625183,
      "rmse_dtheta": 0.038102421909570694,
      "rmse_dx": 0.026958942413330078,
      "rmse_dy": 0.008921696804463863,
      "rmse_mean": 0.024661019444465637,
      "rotation_flip": 0.0069204154424369335,
      "sparse_tokens": 11250.0,
      "step": 8111,
      "turn_loss": 0.24249863624572754,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3768816205166326,
      "grad_norm": 0.397419810295105,
      "learning_rate": 2.4191450631418856e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.008556975983083248,
      "mae_dx": 0.0016393742989748716,
      "mae_dy": 0.0013163569383323193,
      "pose_mae_dtheta": 0.06250905990600586,
      "pose_mae_dx": 0.013768138363957405,
      "pose_mae_dy": 0.011141101829707623,
      "pose_rmse_dtheta": 0.2230224311351776,
      "pose_rmse_dx": 0.039185479283332825,
      "pose_rmse_dy": 0.027336377650499344,
      "pose_rmse_mean": 0.09651477634906769,
      "rmse_dtheta": 0.024550145491957664,
      "rmse_dx": 0.005054674111306667,
      "rmse_dy": 0.0037819896824657917,
      "rmse_mean": 0.01112893596291542,
      "rotation_flip": 0.0032095368951559067,
      "sparse_tokens": 32185.0,
      "step": 8112,
      "turn_loss": 0.057715099304914474,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3769280802824754,
      "grad_norm": 0.49897077679634094,
      "learning_rate": 2.418012691805191e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.006087176036089659,
      "mae_dx": 0.00098277791403234,
      "mae_dy": 0.0010140060912817717,
      "pose_mae_dtheta": 0.038309384137392044,
      "pose_mae_dx": 0.011606771498918533,
      "pose_mae_dy": 0.014461850747466087,
      "pose_rmse_dtheta": 0.11897093057632446,
      "pose_rmse_dx": 0.0307659562677145,
      "pose_rmse_dy": 0.035198066383600235,
      "pose_rmse_mean": 0.06164498254656792,
      "rmse_dtheta": 0.015366763807833195,
      "rmse_dx": 0.003022104734554887,
      "rmse_dy": 0.0021654204465448856,
      "rmse_mean": 0.0068514300510287285,
      "rotation_flip": 0.003530450165271759,
      "sparse_tokens": 32121.0,
      "step": 8113,
      "turn_loss": 0.05015520751476288,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.37697454004831815,
      "grad_norm": 0.654526948928833,
      "learning_rate": 2.416880501028255e-06,
      "loss": 0.1802,
      "mae_dtheta": 0.03444633632898331,
      "mae_dx": 0.013833221048116684,
      "mae_dy": 0.004943333100527525,
      "pose_mae_dtheta": 0.25397810339927673,
      "pose_mae_dx": 0.10404195636510849,
      "pose_mae_dy": 0.06206132471561432,
      "pose_rmse_dtheta": 0.44068747758865356,
      "pose_rmse_dx": 0.23190510272979736,
      "pose_rmse_dy": 0.14714379608631134,
      "pose_rmse_mean": 0.2732454538345337,
      "rmse_dtheta": 0.05186077952384949,
      "rmse_dx": 0.027476182207465172,
      "rmse_dy": 0.00955986324697733,
      "rmse_mean": 0.02963227592408657,
      "rotation_flip": 0.02386363595724106,
      "sparse_tokens": 15203.0,
      "step": 8114,
      "turn_loss": 0.2662731409072876,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.37702099981416093,
      "grad_norm": 1.2787002325057983,
      "learning_rate": 2.4157484908902536e-06,
      "loss": 0.3133,
      "mae_dtheta": 0.045263972133398056,
      "mae_dx": 0.012167400680482388,
      "mae_dy": 0.002787507837638259,
      "pose_mae_dtheta": 0.3853025734424591,
      "pose_mae_dx": 0.09587538242340088,
      "pose_mae_dy": 0.03141287341713905,
      "pose_rmse_dtheta": 0.6334534883499146,
      "pose_rmse_dx": 0.19121816754341125,
      "pose_rmse_dy": 0.07490664720535278,
      "pose_rmse_mean": 0.2998594343662262,
      "rmse_dtheta": 0.06415065377950668,
      "rmse_dx": 0.023493729531764984,
      "rmse_dy": 0.005688266362994909,
      "rmse_mean": 0.03111088275909424,
      "rotation_flip": 0.01149425283074379,
      "sparse_tokens": 11939.0,
      "step": 8115,
      "turn_loss": 0.2889382839202881,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.3770674595800037,
      "grad_norm": 0.5919420123100281,
      "learning_rate": 2.4146166614703454e-06,
      "loss": 0.1453,
      "mae_dtheta": 0.03974728286266327,
      "mae_dx": 0.015127510763704777,
      "mae_dy": 0.0097623560577631,
      "pose_mae_dtheta": 0.26637423038482666,
      "pose_mae_dx": 0.09799223393201828,
      "pose_mae_dy": 0.09671580046415329,
      "pose_rmse_dtheta": 0.4977118670940399,
      "pose_rmse_dx": 0.21797442436218262,
      "pose_rmse_dy": 0.21669705212116241,
      "pose_rmse_mean": 0.310794472694397,
      "rmse_dtheta": 0.05891987308859825,
      "rmse_dx": 0.028960682451725006,
      "rmse_dy": 0.016177674755454063,
      "rmse_mean": 0.03468607738614082,
      "rotation_flip": 0.027027027681469917,
      "sparse_tokens": 5254.0,
      "step": 8116,
      "turn_loss": 0.34833410382270813,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3771139193458465,
      "grad_norm": 0.6692633032798767,
      "learning_rate": 2.413485012847683e-06,
      "loss": 0.1005,
      "mae_dtheta": 0.005608553532510996,
      "mae_dx": 0.001264064572751522,
      "mae_dy": 0.00123042322229594,
      "pose_mae_dtheta": 0.03570028766989708,
      "pose_mae_dx": 0.01334892213344574,
      "pose_mae_dy": 0.01397525891661644,
      "pose_rmse_dtheta": 0.07684348523616791,
      "pose_rmse_dx": 0.03469495847821236,
      "pose_rmse_dy": 0.03931383788585663,
      "pose_rmse_mean": 0.050284095108509064,
      "rmse_dtheta": 0.0144956074655056,
      "rmse_dx": 0.00398850254714489,
      "rmse_dy": 0.0036557421553879976,
      "rmse_mean": 0.0073799509555101395,
      "rotation_flip": 0.00218150089494884,
      "sparse_tokens": 32169.0,
      "step": 8117,
      "turn_loss": 0.06632380187511444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.37716037911168926,
      "grad_norm": 0.5406396985054016,
      "learning_rate": 2.412353545101401e-06,
      "loss": 0.0878,
      "mae_dtheta": 0.014781112782657146,
      "mae_dx": 0.0030709963757544756,
      "mae_dy": 0.004529391415417194,
      "pose_mae_dtheta": 0.09461997449398041,
      "pose_mae_dx": 0.03523813188076019,
      "pose_mae_dy": 0.03848482668399811,
      "pose_rmse_dtheta": 0.2024269998073578,
      "pose_rmse_dx": 0.10905973613262177,
      "pose_rmse_dy": 0.08374764025211334,
      "pose_rmse_mean": 0.13174478709697723,
      "rmse_dtheta": 0.029069257900118828,
      "rmse_dx": 0.01051499042659998,
      "rmse_dy": 0.01044318825006485,
      "rmse_mean": 0.016675813123583794,
      "rotation_flip": 0.010498687624931335,
      "sparse_tokens": 32089.0,
      "step": 8118,
      "turn_loss": 0.15457576513290405,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27254.0,
      "epoch": 0.37720683887753204,
      "grad_norm": 0.41843822598457336,
      "learning_rate": 2.411222258310626e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.030657190829515457,
      "mae_dx": 0.010130934417247772,
      "mae_dy": 0.005347288213670254,
      "pose_mae_dtheta": 0.2457829862833023,
      "pose_mae_dx": 0.0879831463098526,
      "pose_mae_dy": 0.05564810335636139,
      "pose_rmse_dtheta": 0.4331461191177368,
      "pose_rmse_dx": 0.19768716394901276,
      "pose_rmse_dy": 0.13796448707580566,
      "pose_rmse_mean": 0.25626593828201294,
      "rmse_dtheta": 0.048677556216716766,
      "rmse_dx": 0.02161744050681591,
      "rmse_dy": 0.012172771617770195,
      "rmse_mean": 0.027489257976412773,
      "rotation_flip": 0.012647555209696293,
      "sparse_tokens": 20445.0,
      "step": 8119,
      "turn_loss": 0.29348376393318176,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 39588.0,
      "epoch": 0.3772532986433748,
      "grad_norm": 0.518549382686615,
      "learning_rate": 2.410091152554466e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.033949315547943115,
      "mae_dx": 0.012075052596628666,
      "mae_dy": 0.006898915860801935,
      "pose_mae_dtheta": 0.25989606976509094,
      "pose_mae_dx": 0.0966518297791481,
      "pose_mae_dy": 0.07832036912441254,
      "pose_rmse_dtheta": 0.4515412151813507,
      "pose_rmse_dx": 0.20550459623336792,
      "pose_rmse_dy": 0.19388726353645325,
      "pose_rmse_mean": 0.2836443781852722,
      "rmse_dtheta": 0.05091407150030136,
      "rmse_dx": 0.024208594113588333,
      "rmse_dy": 0.01504454854875803,
      "rmse_mean": 0.030055738985538483,
      "rotation_flip": 0.010982976295053959,
      "sparse_tokens": 29988.0,
      "step": 8120,
      "turn_loss": 0.2944473624229431,
      "turns": 122.0,
      "turns_per_sample": 122.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.37729975840921764,
      "grad_norm": 0.6839169859886169,
      "learning_rate": 2.4089602279120224e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.03272036835551262,
      "mae_dx": 0.009332935325801373,
      "mae_dy": 0.007082207594066858,
      "pose_mae_dtheta": 0.28499284386634827,
      "pose_mae_dx": 0.08312474936246872,
      "pose_mae_dy": 0.07767254114151001,
      "pose_rmse_dtheta": 0.5185726284980774,
      "pose_rmse_dx": 0.18826895952224731,
      "pose_rmse_dy": 0.1624431014060974,
      "pose_rmse_mean": 0.28976157307624817,
      "rmse_dtheta": 0.05087452754378319,
      "rmse_dx": 0.020366599783301353,
      "rmse_dy": 0.015875468030571938,
      "rmse_mean": 0.029038865119218826,
      "rotation_flip": 0.012903225608170033,
      "sparse_tokens": 7549.0,
      "step": 8121,
      "turn_loss": 0.2637282609939575,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3773462181750604,
      "grad_norm": 0.6414880752563477,
      "learning_rate": 2.4078294844623816e-06,
      "loss": 0.1669,
      "mae_dtheta": 0.011004146188497543,
      "mae_dx": 0.002167892176657915,
      "mae_dy": 0.0027683936059474945,
      "pose_mae_dtheta": 0.07502342015504837,
      "pose_mae_dx": 0.02578118070960045,
      "pose_mae_dy": 0.03314774110913277,
      "pose_rmse_dtheta": 0.1884152591228485,
      "pose_rmse_dx": 0.0620255172252655,
      "pose_rmse_dy": 0.07269146293401718,
      "pose_rmse_mean": 0.10771074891090393,
      "rmse_dtheta": 0.022933879867196083,
      "rmse_dx": 0.006463795900344849,
      "rmse_dy": 0.006509024649858475,
      "rmse_mean": 0.011968901380896568,
      "rotation_flip": 0.0043685464188456535,
      "sparse_tokens": 32089.0,
      "step": 8122,
      "turn_loss": 0.10503450036048889,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3773926779409032,
      "grad_norm": 0.43208107352256775,
      "learning_rate": 2.4066989222846152e-06,
      "loss": 0.0856,
      "mae_dtheta": 0.010162091813981533,
      "mae_dx": 0.0022489612456411123,
      "mae_dy": 0.002432257868349552,
      "pose_mae_dtheta": 0.07276523113250732,
      "pose_mae_dx": 0.022060507908463478,
      "pose_mae_dy": 0.02839796245098114,
      "pose_rmse_dtheta": 0.18248853087425232,
      "pose_rmse_dx": 0.059126146137714386,
      "pose_rmse_dy": 0.06797229498624802,
      "pose_rmse_mean": 0.1031956598162651,
      "rmse_dtheta": 0.021932171657681465,
      "rmse_dx": 0.008527272380888462,
      "rmse_dy": 0.006137172691524029,
      "rmse_mean": 0.012198872864246368,
      "rotation_flip": 0.0031225604470819235,
      "sparse_tokens": 32105.0,
      "step": 8123,
      "turn_loss": 0.08748288452625275,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10733.0,
      "epoch": 0.377439137706746,
      "grad_norm": 0.6011872291564941,
      "learning_rate": 2.4055685414577866e-06,
      "loss": 0.0783,
      "mae_dtheta": 0.02218790166079998,
      "mae_dx": 0.00938095711171627,
      "mae_dy": 0.002421401673927903,
      "pose_mae_dtheta": 0.1467217206954956,
      "pose_mae_dx": 0.07105312496423721,
      "pose_mae_dy": 0.021562620997428894,
      "pose_rmse_dtheta": 0.3236435353755951,
      "pose_rmse_dx": 0.20259153842926025,
      "pose_rmse_dy": 0.05208199471235275,
      "pose_rmse_mean": 0.19277237355709076,
      "rmse_dtheta": 0.04041134938597679,
      "rmse_dx": 0.021951671689748764,
      "rmse_dy": 0.0053546675480902195,
      "rmse_mean": 0.022572562098503113,
      "rotation_flip": 0.015625,
      "sparse_tokens": 9150.0,
      "step": 8124,
      "turn_loss": 0.18280059099197388,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.37748559747258875,
      "grad_norm": 0.5168169736862183,
      "learning_rate": 2.404438342060941e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.010987014509737492,
      "mae_dx": 0.001121065579354763,
      "mae_dy": 0.0019027136731892824,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5168170928955078,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.57778930664062,
      "model/head/act_norm_mean": 107.19339883207071,
      "model/head/act_norm_min": 57.198280334472656,
      "model/head/act_over_embed": 73.6643072378102,
      "model/head/grad_frac": 0.09744593501091003,
      "model/head/grad_norm": 0.05036172643303871,
      "model/head/grad_zero_frac": 0.00022494568838737905,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7035392992424242,
      "model/head/update_ratio": 0.0008580237627029419,
      "model/head/weight_delta": 9.707592010498047,
      "model/head/weight_delta_rel": 0.17029991745948792,
      "model/head/weight_norm": 58.69502639770508,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4222956597805023,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222403898367433,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4221861958503723,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29016754897262137,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06462559103965759,
      "model/modality_embedder.encoders.pose/grad_norm": 0.033399611711502075,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5441161014573991,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010785951744765043,
      "model/modality_embedder.encoders.pose/weight_delta": 3.10318922996521,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10139086097478867,
      "model/modality_embedder.encoders.pose/weight_norm": 30.965845108032227,
      "model/modality_embedder/grad_frac": 0.06462559103965759,
      "model/modality_embedder/grad_norm": 0.033399611711502075,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5441161014573991,
      "model/modality_embedder/update_ratio": 0.0010785951744765043,
      "model/modality_embedder/weight_delta": 3.10318922996521,
      "model/modality_embedder/weight_delta_rel": 0.10139086097478867,
      "model/modality_embedder/weight_norm": 30.965845108032227,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.34192657470703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.374614197530864,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.048410415649414,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.063253713129154,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.061324238777160645,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.031693413853645325,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011346966493874788,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.60566782951355,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09495210647583008,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.93117904663086,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.66709899902344,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.380892255892256,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.448125839233398,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.754777415758713,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06640041619539261,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03431687131524086,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011546307941898704,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.302872657775879,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11441408842802048,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.721078872680664,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.8201904296875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.248128607503606,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.494161605834961,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.03795971792818,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06346514821052551,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03279987350106239,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010687713511288166,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.571436643600464,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.11992215365171432,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.689327239990234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.2387466430664,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.9711224346641,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.053458213806152,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.22201720687523,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06432819366455078,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.033245909959077835,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011113811051473022,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0607504844665527,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10460192710161209,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.91404914855957,
      "model/normalizer/grad_frac": 0.2443237006664276,
      "model/normalizer/grad_norm": 0.12627066671848297,
      "model/normalizer/grad_zero_frac": 0.00023634768149349838,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016064489027485251,
      "model/normalizer/weight_delta": 6.457306861877441,
      "model/normalizer/weight_delta_rel": 0.08316637575626373,
      "model/normalizer/weight_norm": 78.60235595703125,
      "pose_mae_dtheta": 0.06976860761642456,
      "pose_mae_dx": 0.015037521719932556,
      "pose_mae_dy": 0.023194747045636177,
      "pose_rmse_dtheta": 0.21060363948345184,
      "pose_rmse_dx": 0.03316347301006317,
      "pose_rmse_dy": 0.04773643985390663,
      "pose_rmse_mean": 0.09716784954071045,
      "rmse_dtheta": 0.027161573991179466,
      "rmse_dx": 0.003396059153601527,
      "rmse_dy": 0.004153905902057886,
      "rmse_mean": 0.011570513248443604,
      "rotation_flip": 0.005841548088937998,
      "sparse_tokens": 32105.0,
      "step": 8125,
      "turn_loss": 0.07868048548698425,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.37753205723843153,
      "grad_norm": 0.7319340705871582,
      "learning_rate": 2.403308324173115e-06,
      "loss": 0.1791,
      "mae_dtheta": 0.01374731119722128,
      "mae_dx": 0.0023654166143387556,
      "mae_dy": 0.0032805874943733215,
      "pose_mae_dtheta": 0.09954002499580383,
      "pose_mae_dx": 0.025487320497632027,
      "pose_mae_dy": 0.03630819544196129,
      "pose_rmse_dtheta": 0.2732674181461334,
      "pose_rmse_dx": 0.0657513365149498,
      "pose_rmse_dy": 0.10665171593427658,
      "pose_rmse_mean": 0.14855682849884033,
      "rmse_dtheta": 0.028238574042916298,
      "rmse_dx": 0.008838283829391003,
      "rmse_dy": 0.008516433648765087,
      "rmse_mean": 0.01519776415079832,
      "rotation_flip": 0.008310249075293541,
      "sparse_tokens": 32121.0,
      "step": 8126,
      "turn_loss": 0.12156447023153305,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.3775785170042743,
      "grad_norm": 1.966365098953247,
      "learning_rate": 2.402178487873333e-06,
      "loss": 0.3112,
      "mae_dtheta": 0.03955185040831566,
      "mae_dx": 0.005041883327066898,
      "mae_dy": 0.007524410728365183,
      "pose_mae_dtheta": 0.3166782259941101,
      "pose_mae_dx": 0.052422523498535156,
      "pose_mae_dy": 0.09023362398147583,
      "pose_rmse_dtheta": 0.6305294036865234,
      "pose_rmse_dx": 0.12342654168605804,
      "pose_rmse_dy": 0.2203492969274521,
      "pose_rmse_mean": 0.32476842403411865,
      "rmse_dtheta": 0.06434031575918198,
      "rmse_dx": 0.00953629706054926,
      "rmse_dy": 0.01579318195581436,
      "rmse_mean": 0.02988993190228939,
      "rotation_flip": 0.0,
      "sparse_tokens": 3160.0,
      "step": 8127,
      "turn_loss": 0.28425535559654236,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3776249767701171,
      "grad_norm": 0.6458250284194946,
      "learning_rate": 2.401048833240602e-06,
      "loss": 0.1535,
      "mae_dtheta": 0.014345970936119556,
      "mae_dx": 0.0034685421269387007,
      "mae_dy": 0.004270337987691164,
      "pose_mae_dtheta": 0.10985136777162552,
      "pose_mae_dx": 0.04347511753439903,
      "pose_mae_dy": 0.04391487315297127,
      "pose_rmse_dtheta": 0.25915029644966125,
      "pose_rmse_dx": 0.11202595382928848,
      "pose_rmse_dy": 0.1137530654668808,
      "pose_rmse_mean": 0.1616431176662445,
      "rmse_dtheta": 0.028923671692609787,
      "rmse_dx": 0.009024661965668201,
      "rmse_dy": 0.009696897119283676,
      "rmse_mean": 0.015881743282079697,
      "rotation_flip": 0.009084556251764297,
      "sparse_tokens": 32137.0,
      "step": 8128,
      "turn_loss": 0.13659094274044037,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29522.0,
      "epoch": 0.37767143653595986,
      "grad_norm": 0.5961964130401611,
      "learning_rate": 2.3999193603539234e-06,
      "loss": 0.1297,
      "mae_dtheta": 0.02509947679936886,
      "mae_dx": 0.007759507745504379,
      "mae_dy": 0.004027585498988628,
      "pose_mae_dtheta": 0.18554596602916718,
      "pose_mae_dx": 0.06885144859552383,
      "pose_mae_dy": 0.051816362887620926,
      "pose_rmse_dtheta": 0.36022743582725525,
      "pose_rmse_dx": 0.19392240047454834,
      "pose_rmse_dy": 0.13956134021282196,
      "pose_rmse_mean": 0.23123708367347717,
      "rmse_dtheta": 0.043138258159160614,
      "rmse_dx": 0.019661279395222664,
      "rmse_dy": 0.008396487683057785,
      "rmse_mean": 0.023732006549835205,
      "rotation_flip": 0.007312614470720291,
      "sparse_tokens": 23082.0,
      "step": 8129,
      "turn_loss": 0.17132414877414703,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.37771789630180264,
      "grad_norm": 0.4350799024105072,
      "learning_rate": 2.3987900692922773e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.006587151437997818,
      "mae_dx": 0.0016233070055022836,
      "mae_dy": 0.0013998906360939145,
      "pose_mae_dtheta": 0.048321787267923355,
      "pose_mae_dx": 0.01727474480867386,
      "pose_mae_dy": 0.01858406513929367,
      "pose_rmse_dtheta": 0.10981810837984085,
      "pose_rmse_dx": 0.05033225566148758,
      "pose_rmse_dy": 0.05223064124584198,
      "pose_rmse_mean": 0.07079367339611053,
      "rmse_dtheta": 0.014962783083319664,
      "rmse_dx": 0.005216232035309076,
      "rmse_dy": 0.0037835033144801855,
      "rmse_mean": 0.007987506687641144,
      "rotation_flip": 0.001505268388427794,
      "sparse_tokens": 32105.0,
      "step": 8130,
      "turn_loss": 0.05804017558693886,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.3777643560676454,
      "grad_norm": 0.8577081561088562,
      "learning_rate": 2.3976609601346395e-06,
      "loss": 0.1156,
      "mae_dtheta": 0.005642572417855263,
      "mae_dx": 0.0016310359351336956,
      "mae_dy": 0.0002780034556053579,
      "pose_mae_dtheta": 0.04033038765192032,
      "pose_mae_dx": 0.012610610574483871,
      "pose_mae_dy": 0.0033962668385356665,
      "pose_rmse_dtheta": 0.16022540628910065,
      "pose_rmse_dx": 0.027830785140395164,
      "pose_rmse_dy": 0.007116282358765602,
      "pose_rmse_mean": 0.06505749374628067,
      "rmse_dtheta": 0.021378841251134872,
      "rmse_dx": 0.004243957810103893,
      "rmse_dy": 0.0006434491369873285,
      "rmse_mean": 0.008755416609346867,
      "rotation_flip": 0.004464285913854837,
      "sparse_tokens": 32217.0,
      "step": 8131,
      "turn_loss": 0.04422886297106743,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33310.0,
      "epoch": 0.3778108158334882,
      "grad_norm": 0.5466775298118591,
      "learning_rate": 2.3965320329599657e-06,
      "loss": 0.1494,
      "mae_dtheta": 0.03991743549704552,
      "mae_dx": 0.013851948082447052,
      "mae_dy": 0.006335611920803785,
      "pose_mae_dtheta": 0.3119107484817505,
      "pose_mae_dx": 0.11357881128787994,
      "pose_mae_dy": 0.07618796080350876,
      "pose_rmse_dtheta": 0.5297453999519348,
      "pose_rmse_dx": 0.24301528930664062,
      "pose_rmse_dy": 0.17971403896808624,
      "pose_rmse_mean": 0.3174915909767151,
      "rmse_dtheta": 0.05781671777367592,
      "rmse_dx": 0.026541901752352715,
      "rmse_dy": 0.01340037677437067,
      "rmse_mean": 0.03258633241057396,
      "rotation_flip": 0.016318537294864655,
      "sparse_tokens": 26805.0,
      "step": 8132,
      "turn_loss": 0.3393977880477905,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.37785727559933097,
      "grad_norm": 0.4944579303264618,
      "learning_rate": 2.3954032878472063e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.012630341574549675,
      "mae_dx": 0.0016989647410809994,
      "mae_dy": 0.0033555636182427406,
      "pose_mae_dtheta": 0.08837717026472092,
      "pose_mae_dx": 0.03112880326807499,
      "pose_mae_dy": 0.04022127762436867,
      "pose_rmse_dtheta": 0.2293473333120346,
      "pose_rmse_dx": 0.09447827190160751,
      "pose_rmse_dy": 0.10149174183607101,
      "pose_rmse_mean": 0.14177244901657104,
      "rmse_dtheta": 0.02692909725010395,
      "rmse_dx": 0.004808397497981787,
      "rmse_dy": 0.0073795500211417675,
      "rmse_mean": 0.013039015233516693,
      "rotation_flip": 0.005343783181160688,
      "sparse_tokens": 32105.0,
      "step": 8133,
      "turn_loss": 0.10659074038267136,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.37790373536517374,
      "grad_norm": 0.5198987722396851,
      "learning_rate": 2.3942747248752907e-06,
      "loss": 0.1019,
      "mae_dtheta": 0.008456343784928322,
      "mae_dx": 0.0014653942780569196,
      "mae_dy": 0.0017523405840620399,
      "pose_mae_dtheta": 0.05860597640275955,
      "pose_mae_dx": 0.014616362750530243,
      "pose_mae_dy": 0.02068314328789711,
      "pose_rmse_dtheta": 0.13353708386421204,
      "pose_rmse_dx": 0.035977281630039215,
      "pose_rmse_dy": 0.047385722398757935,
      "pose_rmse_mean": 0.0723000317811966,
      "rmse_dtheta": 0.018937310203909874,
      "rmse_dx": 0.004770346917212009,
      "rmse_dy": 0.004901195876300335,
      "rmse_mean": 0.00953628495335579,
      "rotation_flip": 0.004196390975266695,
      "sparse_tokens": 32105.0,
      "step": 8134,
      "turn_loss": 0.07241862267255783,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3779501951310165,
      "grad_norm": 0.5135382413864136,
      "learning_rate": 2.3931463441231446e-06,
      "loss": 0.1187,
      "mae_dtheta": 0.010997475124895573,
      "mae_dx": 0.0016633522463962436,
      "mae_dy": 0.0017991320928558707,
      "pose_mae_dtheta": 0.0830211415886879,
      "pose_mae_dx": 0.021268930286169052,
      "pose_mae_dy": 0.02585596777498722,
      "pose_rmse_dtheta": 0.23999282717704773,
      "pose_rmse_dx": 0.058804504573345184,
      "pose_rmse_dy": 0.06754017621278763,
      "pose_rmse_mean": 0.12211250513792038,
      "rmse_dtheta": 0.026924706995487213,
      "rmse_dx": 0.005630554631352425,
      "rmse_dy": 0.004209497012197971,
      "rmse_mean": 0.012254918925464153,
      "rotation_flip": 0.0031965903472155333,
      "sparse_tokens": 32057.0,
      "step": 8135,
      "turn_loss": 0.08078127354383469,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3779966548968593,
      "grad_norm": 0.353339821100235,
      "learning_rate": 2.3920181456696717e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.006476534064859152,
      "mae_dx": 0.001357099274173379,
      "mae_dy": 0.0012634071754291654,
      "pose_mae_dtheta": 0.04334567114710808,
      "pose_mae_dx": 0.013606078922748566,
      "pose_mae_dy": 0.015032071620225906,
      "pose_rmse_dtheta": 0.1220732256770134,
      "pose_rmse_dx": 0.03291740268468857,
      "pose_rmse_dy": 0.039471335709095,
      "pose_rmse_mean": 0.06482066214084625,
      "rmse_dtheta": 0.017735416069626808,
      "rmse_dx": 0.003754358272999525,
      "rmse_dy": 0.0028473592828959227,
      "rmse_mean": 0.008112378418445587,
      "rotation_flip": 0.004315417725592852,
      "sparse_tokens": 32201.0,
      "step": 8136,
      "turn_loss": 0.051035426557064056,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3780431146627021,
      "grad_norm": 0.4151882529258728,
      "learning_rate": 2.3908901295937713e-06,
      "loss": 0.1264,
      "mae_dtheta": 0.009119904600083828,
      "mae_dx": 0.0013556629419326782,
      "mae_dy": 0.0016695511294528842,
      "pose_mae_dtheta": 0.0633561909198761,
      "pose_mae_dx": 0.016237137839198112,
      "pose_mae_dy": 0.020070306956768036,
      "pose_rmse_dtheta": 0.2167467623949051,
      "pose_rmse_dx": 0.03932436928153038,
      "pose_rmse_dy": 0.05145259574055672,
      "pose_rmse_mean": 0.10250791162252426,
      "rmse_dtheta": 0.02550913766026497,
      "rmse_dx": 0.00398253183811903,
      "rmse_dy": 0.0037344840820878744,
      "rmse_mean": 0.01107538491487503,
      "rotation_flip": 0.0011355034075677395,
      "sparse_tokens": 32153.0,
      "step": 8137,
      "turn_loss": 0.06609699130058289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3780895744285449,
      "grad_norm": 0.5945124626159668,
      "learning_rate": 2.3897622959743226e-06,
      "loss": 0.1234,
      "mae_dtheta": 0.009509303607046604,
      "mae_dx": 0.0009047466446645558,
      "mae_dy": 0.0017222322057932615,
      "pose_mae_dtheta": 0.06148542836308479,
      "pose_mae_dx": 0.014605594798922539,
      "pose_mae_dy": 0.023074382916092873,
      "pose_rmse_dtheta": 0.17790193855762482,
      "pose_rmse_dx": 0.03838299959897995,
      "pose_rmse_dy": 0.04992327466607094,
      "pose_rmse_mean": 0.08873607218265533,
      "rmse_dtheta": 0.022534068673849106,
      "rmse_dx": 0.002831448335200548,
      "rmse_dy": 0.0034770674537867308,
      "rmse_mean": 0.009614194743335247,
      "rotation_flip": 0.0038893690798431635,
      "sparse_tokens": 32057.0,
      "step": 8138,
      "turn_loss": 0.06752613186836243,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.3781360341943877,
      "grad_norm": 0.49136075377464294,
      "learning_rate": 2.3886346448902005e-06,
      "loss": 0.0758,
      "mae_dtheta": 0.0333562046289444,
      "mae_dx": 0.014406652189791203,
      "mae_dy": 0.0037144210655242205,
      "pose_mae_dtheta": 0.26227620244026184,
      "pose_mae_dx": 0.1067066565155983,
      "pose_mae_dy": 0.046491287648677826,
      "pose_rmse_dtheta": 0.4327625632286072,
      "pose_rmse_dx": 0.23533804714679718,
      "pose_rmse_dy": 0.11358692497015,
      "pose_rmse_mean": 0.2605625092983246,
      "rmse_dtheta": 0.05018536373972893,
      "rmse_dx": 0.027269132435321808,
      "rmse_dy": 0.007765071000903845,
      "rmse_mean": 0.028406521305441856,
      "rotation_flip": 0.014319809153676033,
      "sparse_tokens": 14503.0,
      "step": 8139,
      "turn_loss": 0.24784110486507416,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.37818249396023046,
      "grad_norm": 0.7337955236434937,
      "learning_rate": 2.387507176420256e-06,
      "loss": 0.1759,
      "mae_dtheta": 0.008153442293405533,
      "mae_dx": 0.0016541596269235015,
      "mae_dy": 0.0019137341296300292,
      "pose_mae_dtheta": 0.054526496678590775,
      "pose_mae_dx": 0.01767120137810707,
      "pose_mae_dy": 0.02225528657436371,
      "pose_rmse_dtheta": 0.10955624282360077,
      "pose_rmse_dx": 0.057516343891620636,
      "pose_rmse_dy": 0.050851769745349884,
      "pose_rmse_mean": 0.07264145463705063,
      "rmse_dtheta": 0.017547115683555603,
      "rmse_dx": 0.006227014120668173,
      "rmse_dy": 0.0051367273554205894,
      "rmse_mean": 0.009636952541768551,
      "rotation_flip": 0.0067311739549040794,
      "sparse_tokens": 32137.0,
      "step": 8140,
      "turn_loss": 0.0760248601436615,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.37822895372607324,
      "grad_norm": 0.5498547554016113,
      "learning_rate": 2.3863798906433396e-06,
      "loss": 0.1502,
      "mae_dtheta": 0.03571828827261925,
      "mae_dx": 0.008037573657929897,
      "mae_dy": 0.004368288442492485,
      "pose_mae_dtheta": 0.2682545483112335,
      "pose_mae_dx": 0.06612126529216766,
      "pose_mae_dy": 0.05818290635943413,
      "pose_rmse_dtheta": 0.5012982487678528,
      "pose_rmse_dx": 0.15187235176563263,
      "pose_rmse_dy": 0.12268000096082687,
      "pose_rmse_mean": 0.2586168646812439,
      "rmse_dtheta": 0.05539616942405701,
      "rmse_dx": 0.01856371760368347,
      "rmse_dy": 0.00936984270811081,
      "rmse_mean": 0.027776576578617096,
      "rotation_flip": 0.009489917196333408,
      "sparse_tokens": 14920.0,
      "step": 8141,
      "turn_loss": 0.23919959366321564,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.378275413491916,
      "grad_norm": 0.6337648034095764,
      "learning_rate": 2.385252787638278e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.012711706571280956,
      "mae_dx": 0.0015777095686644316,
      "mae_dy": 0.0018934760009869933,
      "pose_mae_dtheta": 0.09247955679893494,
      "pose_mae_dx": 0.023307351395487785,
      "pose_mae_dy": 0.0237988643348217,
      "pose_rmse_dtheta": 0.2758537530899048,
      "pose_rmse_dx": 0.054726239293813705,
      "pose_rmse_dy": 0.05592140555381775,
      "pose_rmse_mean": 0.1288338005542755,
      "rmse_dtheta": 0.029791587963700294,
      "rmse_dx": 0.004657584708184004,
      "rmse_dy": 0.003924555145204067,
      "rmse_mean": 0.012791242450475693,
      "rotation_flip": 0.005347593687474728,
      "sparse_tokens": 32105.0,
      "step": 8142,
      "turn_loss": 0.0754941999912262,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3783218732577588,
      "grad_norm": 0.3416908085346222,
      "learning_rate": 2.3841258674838948e-06,
      "loss": 0.0994,
      "mae_dtheta": 0.013075405731797218,
      "mae_dx": 0.00196039117872715,
      "mae_dy": 0.0039056376554071903,
      "pose_mae_dtheta": 0.07882861793041229,
      "pose_mae_dx": 0.03215150162577629,
      "pose_mae_dy": 0.03880232572555542,
      "pose_rmse_dtheta": 0.1492203027009964,
      "pose_rmse_dx": 0.08064673840999603,
      "pose_rmse_dy": 0.0811627060174942,
      "pose_rmse_mean": 0.10367657989263535,
      "rmse_dtheta": 0.023151475936174393,
      "rmse_dx": 0.004542311187833548,
      "rmse_dy": 0.007320146542042494,
      "rmse_mean": 0.011671311222016811,
      "rotation_flip": 0.007971938699483871,
      "sparse_tokens": 32121.0,
      "step": 8143,
      "turn_loss": 0.1180882677435875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.37836833302360157,
      "grad_norm": 0.5350791811943054,
      "learning_rate": 2.3829991302589912e-06,
      "loss": 0.1069,
      "mae_dtheta": 0.03521808236837387,
      "mae_dx": 0.008251634426414967,
      "mae_dy": 0.0031744653824716806,
      "pose_mae_dtheta": 0.32888859510421753,
      "pose_mae_dx": 0.06843956559896469,
      "pose_mae_dy": 0.022105112671852112,
      "pose_rmse_dtheta": 0.5239623785018921,
      "pose_rmse_dx": 0.1370689868927002,
      "pose_rmse_dy": 0.05308635160326958,
      "pose_rmse_mean": 0.23803924024105072,
      "rmse_dtheta": 0.05310263857245445,
      "rmse_dx": 0.016170000657439232,
      "rmse_dy": 0.007995102554559708,
      "rmse_mean": 0.02575591206550598,
      "rotation_flip": 0.017331022769212723,
      "sparse_tokens": 9156.0,
      "step": 8144,
      "turn_loss": 0.20945146679878235,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.37841479278944434,
      "grad_norm": 0.4528178870677948,
      "learning_rate": 2.381872576042365e-06,
      "loss": 0.1161,
      "mae_dtheta": 0.008283799514174461,
      "mae_dx": 0.0012685948750004172,
      "mae_dy": 0.0019599541556090117,
      "pose_mae_dtheta": 0.04861600697040558,
      "pose_mae_dx": 0.016054658219218254,
      "pose_mae_dy": 0.023504721000790596,
      "pose_rmse_dtheta": 0.0973888710141182,
      "pose_rmse_dx": 0.041194479912519455,
      "pose_rmse_dy": 0.05978148803114891,
      "pose_rmse_mean": 0.06612161546945572,
      "rmse_dtheta": 0.016177652403712273,
      "rmse_dx": 0.003757582977414131,
      "rmse_dy": 0.00400337902829051,
      "rmse_mean": 0.007979538291692734,
      "rotation_flip": 0.008124076761305332,
      "sparse_tokens": 32089.0,
      "step": 8145,
      "turn_loss": 0.06893247365951538,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.3784612525552871,
      "grad_norm": 0.6084721088409424,
      "learning_rate": 2.3807462049127934e-06,
      "loss": 0.1543,
      "mae_dtheta": 0.03455229848623276,
      "mae_dx": 0.011062917299568653,
      "mae_dy": 0.003731384640559554,
      "pose_mae_dtheta": 0.27978113293647766,
      "pose_mae_dx": 0.08712697774171829,
      "pose_mae_dy": 0.029659414663910866,
      "pose_rmse_dtheta": 0.47446179389953613,
      "pose_rmse_dx": 0.18777307868003845,
      "pose_rmse_dy": 0.07472481578588486,
      "pose_rmse_mean": 0.24565324187278748,
      "rmse_dtheta": 0.05375976115465164,
      "rmse_dx": 0.022135663777589798,
      "rmse_dy": 0.006933819968253374,
      "rmse_mean": 0.027609750628471375,
      "rotation_flip": 0.010660980828106403,
      "sparse_tokens": 8402.0,
      "step": 8146,
      "turn_loss": 0.3417987823486328,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.3785077123211299,
      "grad_norm": 0.9357067346572876,
      "learning_rate": 2.379620016949045e-06,
      "loss": 0.1567,
      "mae_dtheta": 0.03457017242908478,
      "mae_dx": 0.006140050943940878,
      "mae_dy": 0.005473800003528595,
      "pose_mae_dtheta": 0.2687778174877167,
      "pose_mae_dx": 0.046661846339702606,
      "pose_mae_dy": 0.04185374826192856,
      "pose_rmse_dtheta": 0.4476372003555298,
      "pose_rmse_dx": 0.1034814789891243,
      "pose_rmse_dy": 0.09910235553979874,
      "pose_rmse_mean": 0.21674035489559174,
      "rmse_dtheta": 0.05172431468963623,
      "rmse_dx": 0.014243909157812595,
      "rmse_dy": 0.013020936399698257,
      "rmse_mean": 0.02632972225546837,
      "rotation_flip": 0.015988372266292572,
      "sparse_tokens": 10737.0,
      "step": 8147,
      "turn_loss": 0.2647905647754669,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3785541720869727,
      "grad_norm": 0.5686344504356384,
      "learning_rate": 2.378494012229877e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.012133419513702393,
      "mae_dx": 0.0018649715930223465,
      "mae_dy": 0.0028853865806013346,
      "pose_mae_dtheta": 0.07702978700399399,
      "pose_mae_dx": 0.02523002028465271,
      "pose_mae_dy": 0.03641064465045929,
      "pose_rmse_dtheta": 0.17689336836338043,
      "pose_rmse_dx": 0.06205615773797035,
      "pose_rmse_dy": 0.07350806891918182,
      "pose_rmse_mean": 0.10415253043174744,
      "rmse_dtheta": 0.0223690178245306,
      "rmse_dx": 0.005514991469681263,
      "rmse_dy": 0.005572620779275894,
      "rmse_mean": 0.011152210645377636,
      "rotation_flip": 0.004408060573041439,
      "sparse_tokens": 32137.0,
      "step": 8148,
      "turn_loss": 0.10293561965227127,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1986.0,
      "epoch": 0.37860063185281545,
      "grad_norm": 0.7832388281822205,
      "learning_rate": 2.3773681908340284e-06,
      "loss": 0.1682,
      "mae_dtheta": 0.026124468073248863,
      "mae_dx": 0.021602684631943703,
      "mae_dy": 0.006527877878397703,
      "pose_mae_dtheta": 0.2774798572063446,
      "pose_mae_dx": 0.16516658663749695,
      "pose_mae_dy": 0.10658957809209824,
      "pose_rmse_dtheta": 0.5877637267112732,
      "pose_rmse_dx": 0.3726498484611511,
      "pose_rmse_dy": 0.21119901537895203,
      "pose_rmse_mean": 0.3905375599861145,
      "rmse_dtheta": 0.049232110381126404,
      "rmse_dx": 0.03869906812906265,
      "rmse_dy": 0.011486727744340897,
      "rmse_mean": 0.03313930332660675,
      "rotation_flip": 0.0,
      "sparse_tokens": 1809.0,
      "step": 8149,
      "turn_loss": 0.15312868356704712,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3786470916186582,
      "grad_norm": 0.40655508637428284,
      "learning_rate": 2.376242552840232e-06,
      "loss": 0.084,
      "mae_dtheta": 0.006845730356872082,
      "mae_dx": 0.0015507424250245094,
      "mae_dy": 0.0015123918419703841,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.40655505657196045,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.17494201660156,
      "model/head/act_norm_mean": 119.06350615530303,
      "model/head/act_norm_min": 54.494361877441406,
      "model/head/act_over_embed": 81.8215561200311,
      "model/head/grad_frac": 0.10015936940908432,
      "model/head/grad_norm": 0.04072029888629913,
      "model/head/grad_zero_frac": 0.00016974039317574352,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7084171796085859,
      "model/head/update_ratio": 0.0006937482976354659,
      "model/head/weight_delta": 9.713031768798828,
      "model/head/weight_delta_rel": 0.17039534449577332,
      "model/head/weight_norm": 58.69607162475586,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4222743511199951,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42218829739478325,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42210379242897034,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901317505588093,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09513861685991287,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0386790856719017,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5443458381336406,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012490884400904179,
      "model/modality_embedder.encoders.pose/weight_delta": 3.101910352706909,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10134907811880112,
      "model/modality_embedder.encoders.pose/weight_norm": 30.965850830078125,
      "model/modality_embedder/grad_frac": 0.09513861685991287,
      "model/modality_embedder/grad_norm": 0.0386790856719017,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5443458381336406,
      "model/modality_embedder/update_ratio": 0.0012490884400904179,
      "model/modality_embedder/weight_delta": 3.101910352706909,
      "model/modality_embedder/weight_delta_rel": 0.10134907811880112,
      "model/modality_embedder/weight_norm": 30.965850830078125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.8375015258789,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.490783329324994,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.022884368896484,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.83029559023813,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06948499381542206,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.028249474242329597,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010113815078511834,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.60819673538208,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09504426270723343,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.931570053100586,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.67247009277344,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.48312239458073,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.333321571350098,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.51224028630657,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0700075775384903,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.028461934998631477,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009576102020218968,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3057448863983154,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1145135834813118,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.721837997436523,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.21806335449219,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.314990179573513,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.346639633178711,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.771116978370024,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07765088230371475,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.031569357961416245,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001028651837259531,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5748214721679688,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1200358122587204,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.690032958984375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.11909484863281,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.006320646945646,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.1597318649292,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.933415110033465,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10597674548625946,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.043085381388664246,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014402774395421147,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0634026527404785,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10469256341457367,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.914640426635742,
      "model/normalizer/grad_frac": 0.3715563118457794,
      "model/normalizer/grad_norm": 0.15105809271335602,
      "model/normalizer/grad_zero_frac": 0.0001855329319369048,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0019217837834730744,
      "model/normalizer/weight_delta": 6.463200569152832,
      "model/normalizer/weight_delta_rel": 0.08324228227138519,
      "model/normalizer/weight_norm": 78.60306549072266,
      "pose_mae_dtheta": 0.0454646460711956,
      "pose_mae_dx": 0.018064813688397408,
      "pose_mae_dy": 0.01736363209784031,
      "pose_rmse_dtheta": 0.15090934932231903,
      "pose_rmse_dx": 0.07240597903728485,
      "pose_rmse_dy": 0.052713584154844284,
      "pose_rmse_mean": 0.09200963377952576,
      "rmse_dtheta": 0.018257301300764084,
      "rmse_dx": 0.007022830657660961,
      "rmse_dy": 0.00350945140235126,
      "rmse_mean": 0.009596528485417366,
      "rotation_flip": 0.005334626417607069,
      "sparse_tokens": 32057.0,
      "step": 8150,
      "turn_loss": 0.057884715497493744,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.378693551384501,
      "grad_norm": 0.5039104223251343,
      "learning_rate": 2.3751170983272e-06,
      "loss": 0.0924,
      "mae_dtheta": 0.007820864208042622,
      "mae_dx": 0.001882991404272616,
      "mae_dy": 0.001054307445883751,
      "pose_mae_dtheta": 0.05325201898813248,
      "pose_mae_dx": 0.018499156460165977,
      "pose_mae_dy": 0.013835666701197624,
      "pose_rmse_dtheta": 0.169224351644516,
      "pose_rmse_dx": 0.056113891303539276,
      "pose_rmse_dy": 0.0380253829061985,
      "pose_rmse_mean": 0.08778788149356842,
      "rmse_dtheta": 0.022069208323955536,
      "rmse_dx": 0.006796104367822409,
      "rmse_dy": 0.003021753393113613,
      "rmse_mean": 0.010629022493958473,
      "rotation_flip": 0.0011396011104807258,
      "sparse_tokens": 32089.0,
      "step": 8151,
      "turn_loss": 0.054116133600473404,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.3787400111503438,
      "grad_norm": 0.5296710729598999,
      "learning_rate": 2.373991827373638e-06,
      "loss": 0.1156,
      "mae_dtheta": 0.031321752816438675,
      "mae_dx": 0.013329744338989258,
      "mae_dy": 0.0049411943182349205,
      "pose_mae_dtheta": 0.24896307289600372,
      "pose_mae_dx": 0.10664781928062439,
      "pose_mae_dy": 0.0696907564997673,
      "pose_rmse_dtheta": 0.46454301476478577,
      "pose_rmse_dx": 0.24879837036132812,
      "pose_rmse_dy": 0.16963687539100647,
      "pose_rmse_mean": 0.2943260669708252,
      "rmse_dtheta": 0.04965580627322197,
      "rmse_dx": 0.027411291375756264,
      "rmse_dy": 0.00882257241755724,
      "rmse_mean": 0.028629891574382782,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 11939.0,
      "step": 8152,
      "turn_loss": 0.23727668821811676,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.37878647091618656,
      "grad_norm": 0.7578956484794617,
      "learning_rate": 2.372866740058239e-06,
      "loss": 0.113,
      "mae_dtheta": 0.026798253878951073,
      "mae_dx": 0.005369273014366627,
      "mae_dy": 0.0015449863858520985,
      "pose_mae_dtheta": 0.2312053143978119,
      "pose_mae_dx": 0.041627187281847,
      "pose_mae_dy": 0.019895361736416817,
      "pose_rmse_dtheta": 0.480943500995636,
      "pose_rmse_dx": 0.08821133524179459,
      "pose_rmse_dy": 0.057195033878088,
      "pose_rmse_mean": 0.20878329873085022,
      "rmse_dtheta": 0.04969559609889984,
      "rmse_dx": 0.013870266266167164,
      "rmse_dy": 0.003641607705503702,
      "rmse_mean": 0.02240249142050743,
      "rotation_flip": 0.0,
      "sparse_tokens": 5341.0,
      "step": 8153,
      "turn_loss": 0.14810994267463684,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3788329306820294,
      "grad_norm": 0.6459349393844604,
      "learning_rate": 2.3717418364596765e-06,
      "loss": 0.0878,
      "mae_dtheta": 0.006640348583459854,
      "mae_dx": 0.001630056998692453,
      "mae_dy": 0.0007512134616263211,
      "pose_mae_dtheta": 0.04949987307190895,
      "pose_mae_dx": 0.014051361009478569,
      "pose_mae_dy": 0.013279066421091557,
      "pose_rmse_dtheta": 0.15033257007598877,
      "pose_rmse_dx": 0.03799361363053322,
      "pose_rmse_dy": 0.0353693924844265,
      "pose_rmse_mean": 0.07456519454717636,
      "rmse_dtheta": 0.01959647797048092,
      "rmse_dx": 0.0054057566449046135,
      "rmse_dy": 0.0017712003318592906,
      "rmse_mean": 0.00892447866499424,
      "rotation_flip": 0.005089058540761471,
      "sparse_tokens": 32137.0,
      "step": 8154,
      "turn_loss": 0.04925669729709625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.37887939044787217,
      "grad_norm": 1.6390173435211182,
      "learning_rate": 2.3706171166566204e-06,
      "loss": 0.3442,
      "mae_dtheta": 0.028149567544460297,
      "mae_dx": 0.009677167981863022,
      "mae_dy": 0.0044747269712388515,
      "pose_mae_dtheta": 0.2049071490764618,
      "pose_mae_dx": 0.0771525651216507,
      "pose_mae_dy": 0.0438021682202816,
      "pose_rmse_dtheta": 0.3571281135082245,
      "pose_rmse_dx": 0.1769985407590866,
      "pose_rmse_dy": 0.12120093405246735,
      "pose_rmse_mean": 0.21844252943992615,
      "rmse_dtheta": 0.041918061673641205,
      "rmse_dx": 0.021043578162789345,
      "rmse_dy": 0.009419815614819527,
      "rmse_mean": 0.02412715181708336,
      "rotation_flip": 0.02010050229728222,
      "sparse_tokens": 6156.0,
      "step": 8155,
      "turn_loss": 0.2899760901927948,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.37892585021371494,
      "grad_norm": 0.42740729451179504,
      "learning_rate": 2.369492580727719e-06,
      "loss": 0.1014,
      "mae_dtheta": 0.007723625749349594,
      "mae_dx": 0.002835596678778529,
      "mae_dy": 0.0012262559030205011,
      "pose_mae_dtheta": 0.053473759442567825,
      "pose_mae_dx": 0.027285901829600334,
      "pose_mae_dy": 0.017820607870817184,
      "pose_rmse_dtheta": 0.1869627833366394,
      "pose_rmse_dx": 0.09287019073963165,
      "pose_rmse_dy": 0.05858488008379936,
      "pose_rmse_mean": 0.11280594766139984,
      "rmse_dtheta": 0.0241519957780838,
      "rmse_dx": 0.010535063222050667,
      "rmse_dy": 0.003517323639243841,
      "rmse_mean": 0.0127347931265831,
      "rotation_flip": 0.002406738931313157,
      "sparse_tokens": 32121.0,
      "step": 8156,
      "turn_loss": 0.09346066415309906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3789723099795577,
      "grad_norm": 0.593201220035553,
      "learning_rate": 2.3683682287516147e-06,
      "loss": 0.0882,
      "mae_dtheta": 0.011152052320539951,
      "mae_dx": 0.001166169298812747,
      "mae_dy": 0.0023369858972728252,
      "pose_mae_dtheta": 0.07455912977457047,
      "pose_mae_dx": 0.021842768415808678,
      "pose_mae_dy": 0.03094561956822872,
      "pose_rmse_dtheta": 0.16722173988819122,
      "pose_rmse_dx": 0.062375932931900024,
      "pose_rmse_dy": 0.07330187410116196,
      "pose_rmse_mean": 0.10096651315689087,
      "rmse_dtheta": 0.022403482347726822,
      "rmse_dx": 0.0036416759248822927,
      "rmse_dy": 0.005075353197753429,
      "rmse_mean": 0.01037350483238697,
      "rotation_flip": 0.0032051282469183207,
      "sparse_tokens": 32057.0,
      "step": 8157,
      "turn_loss": 0.08257198333740234,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.3790187697454005,
      "grad_norm": 0.39389270544052124,
      "learning_rate": 2.3672440608069316e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.02177586778998375,
      "mae_dx": 0.006869114935398102,
      "mae_dy": 0.005162831861525774,
      "pose_mae_dtheta": 0.14691539108753204,
      "pose_mae_dx": 0.05550607293844223,
      "pose_mae_dy": 0.050158724188804626,
      "pose_rmse_dtheta": 0.3120940029621124,
      "pose_rmse_dx": 0.1630098968744278,
      "pose_rmse_dy": 0.17150992155075073,
      "pose_rmse_mean": 0.21553795039653778,
      "rmse_dtheta": 0.04004547372460365,
      "rmse_dx": 0.01780666597187519,
      "rmse_dy": 0.015439738519489765,
      "rmse_mean": 0.02443062886595726,
      "rotation_flip": 0.015122873708605766,
      "sparse_tokens": 11124.0,
      "step": 8158,
      "turn_loss": 0.19352084398269653,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3790652295112433,
      "grad_norm": 0.6270129680633545,
      "learning_rate": 2.366120076972283e-06,
      "loss": 0.0924,
      "mae_dtheta": 0.009018532931804657,
      "mae_dx": 0.0020665363408625126,
      "mae_dy": 0.0011991672217845917,
      "pose_mae_dtheta": 0.06339102238416672,
      "pose_mae_dx": 0.019771724939346313,
      "pose_mae_dy": 0.01394846010953188,
      "pose_rmse_dtheta": 0.1923016756772995,
      "pose_rmse_dx": 0.05434427037835121,
      "pose_rmse_dy": 0.041628241539001465,
      "pose_rmse_mean": 0.0960913896560669,
      "rmse_dtheta": 0.02395542524755001,
      "rmse_dx": 0.006289418786764145,
      "rmse_dy": 0.0032421813812106848,
      "rmse_mean": 0.011162342503666878,
      "rotation_flip": 0.005993545521050692,
      "sparse_tokens": 32185.0,
      "step": 8159,
      "turn_loss": 0.06402899324893951,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.37911168927708605,
      "grad_norm": 0.5545828938484192,
      "learning_rate": 2.3649962773262743e-06,
      "loss": 0.1456,
      "mae_dtheta": 0.04067885875701904,
      "mae_dx": 0.00678878603503108,
      "mae_dy": 0.008113349787890911,
      "pose_mae_dtheta": 0.3548964262008667,
      "pose_mae_dx": 0.05922100320458412,
      "pose_mae_dy": 0.10411842167377472,
      "pose_rmse_dtheta": 0.620657742023468,
      "pose_rmse_dx": 0.1378839612007141,
      "pose_rmse_dy": 0.24055521190166473,
      "pose_rmse_mean": 0.3330323100090027,
      "rmse_dtheta": 0.05955061689019203,
      "rmse_dx": 0.016694149002432823,
      "rmse_dy": 0.014135009609162807,
      "rmse_mean": 0.03012659214437008,
      "rotation_flip": 0.015082956291735172,
      "sparse_tokens": 10986.0,
      "step": 8160,
      "turn_loss": 0.3643542528152466,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.3791581490429288,
      "grad_norm": 0.578845202922821,
      "learning_rate": 2.363872661947488e-06,
      "loss": 0.1736,
      "mae_dtheta": 0.033515095710754395,
      "mae_dx": 0.01513947919011116,
      "mae_dy": 0.005731638986617327,
      "pose_mae_dtheta": 0.2837224304676056,
      "pose_mae_dx": 0.12056024372577667,
      "pose_mae_dy": 0.06040845811367035,
      "pose_rmse_dtheta": 0.5293404459953308,
      "pose_rmse_dx": 0.2744707465171814,
      "pose_rmse_dy": 0.14143328368663788,
      "pose_rmse_mean": 0.31508150696754456,
      "rmse_dtheta": 0.05160757899284363,
      "rmse_dx": 0.02934027835726738,
      "rmse_dy": 0.010929718613624573,
      "rmse_mean": 0.030625861138105392,
      "rotation_flip": 0.012168142013251781,
      "sparse_tokens": 14365.0,
      "step": 8161,
      "turn_loss": 0.2663174271583557,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3792046088087716,
      "grad_norm": 0.4119302034378052,
      "learning_rate": 2.362749230914503e-06,
      "loss": 0.106,
      "mae_dtheta": 0.007703116629272699,
      "mae_dx": 0.0012866235338151455,
      "mae_dy": 0.0015363467391580343,
      "pose_mae_dtheta": 0.05339604616165161,
      "pose_mae_dx": 0.014135445468127728,
      "pose_mae_dy": 0.016729256138205528,
      "pose_rmse_dtheta": 0.17789942026138306,
      "pose_rmse_dx": 0.05180886387825012,
      "pose_rmse_dy": 0.045546192675828934,
      "pose_rmse_mean": 0.09175150096416473,
      "rmse_dtheta": 0.022413214668631554,
      "rmse_dx": 0.004696046467870474,
      "rmse_dy": 0.005163261201232672,
      "rmse_mean": 0.010757507756352425,
      "rotation_flip": 0.004672897048294544,
      "sparse_tokens": 32089.0,
      "step": 8162,
      "turn_loss": 0.05941810831427574,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36874.0,
      "epoch": 0.3792510685746144,
      "grad_norm": 0.6034432053565979,
      "learning_rate": 2.3616259843058774e-06,
      "loss": 0.2234,
      "mae_dtheta": 0.04817507788538933,
      "mae_dx": 0.01228251587599516,
      "mae_dy": 0.005146249663084745,
      "pose_mae_dtheta": 0.3984939455986023,
      "pose_mae_dx": 0.09798731654882431,
      "pose_mae_dy": 0.06846380233764648,
      "pose_rmse_dtheta": 0.6369642019271851,
      "pose_rmse_dx": 0.2132447063922882,
      "pose_rmse_dy": 0.16784057021141052,
      "pose_rmse_mean": 0.3393498361110687,
      "rmse_dtheta": 0.06665731221437454,
      "rmse_dx": 0.024436570703983307,
      "rmse_dy": 0.01101397443562746,
      "rmse_mean": 0.034035954624414444,
      "rotation_flip": 0.020474137738347054,
      "sparse_tokens": 29013.0,
      "step": 8163,
      "turn_loss": 0.3100053071975708,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.37929752834045716,
      "grad_norm": 0.592414140701294,
      "learning_rate": 2.3605029222001656e-06,
      "loss": 0.1576,
      "mae_dtheta": 0.007685086689889431,
      "mae_dx": 0.00246308371424675,
      "mae_dy": 0.0024785848800092936,
      "pose_mae_dtheta": 0.05497924983501434,
      "pose_mae_dx": 0.02436942607164383,
      "pose_mae_dy": 0.023362061008810997,
      "pose_rmse_dtheta": 0.16400684416294098,
      "pose_rmse_dx": 0.07114958018064499,
      "pose_rmse_dy": 0.0635564774274826,
      "pose_rmse_mean": 0.09957097470760345,
      "rmse_dtheta": 0.020252082496881485,
      "rmse_dx": 0.006595929153263569,
      "rmse_dy": 0.0067210509441792965,
      "rmse_mean": 0.011189687065780163,
      "rotation_flip": 0.0029486098792403936,
      "sparse_tokens": 32169.0,
      "step": 8164,
      "turn_loss": 0.09365725517272949,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.37934398810629993,
      "grad_norm": 0.4714735448360443,
      "learning_rate": 2.359380044675899e-06,
      "loss": 0.1102,
      "mae_dtheta": 0.008985904045403004,
      "mae_dx": 0.0022286432795226574,
      "mae_dy": 0.0023069693706929684,
      "pose_mae_dtheta": 0.06382057815790176,
      "pose_mae_dx": 0.022809047251939774,
      "pose_mae_dy": 0.0247175395488739,
      "pose_rmse_dtheta": 0.15870730578899384,
      "pose_rmse_dx": 0.054505348205566406,
      "pose_rmse_dy": 0.05296909064054489,
      "pose_rmse_mean": 0.08872725069522858,
      "rmse_dtheta": 0.021000180393457413,
      "rmse_dx": 0.0065916310995817184,
      "rmse_dy": 0.005654450505971909,
      "rmse_mean": 0.011082088574767113,
      "rotation_flip": 0.006924643646925688,
      "sparse_tokens": 32121.0,
      "step": 8165,
      "turn_loss": 0.07866110652685165,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.3793904478721427,
      "grad_norm": 1.50989830493927,
      "learning_rate": 2.358257351811603e-06,
      "loss": 0.2349,
      "mae_dtheta": 0.018343893811106682,
      "mae_dx": 0.004020898137241602,
      "mae_dy": 0.003261507023125887,
      "pose_mae_dtheta": 0.0990101546049118,
      "pose_mae_dx": 0.03892766684293747,
      "pose_mae_dy": 0.04170987755060196,
      "pose_rmse_dtheta": 0.18592700362205505,
      "pose_rmse_dx": 0.10910692811012268,
      "pose_rmse_dy": 0.09219922870397568,
      "pose_rmse_mean": 0.1290777325630188,
      "rmse_dtheta": 0.03500308841466904,
      "rmse_dx": 0.011649677529931068,
      "rmse_dy": 0.006988320499658585,
      "rmse_mean": 0.017880361527204514,
      "rotation_flip": 0.00958466436713934,
      "sparse_tokens": 5610.0,
      "step": 8166,
      "turn_loss": 0.12874802947044373,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3794369076379855,
      "grad_norm": 0.31775858998298645,
      "learning_rate": 2.3571348436857906e-06,
      "loss": 0.0919,
      "mae_dtheta": 0.007184057496488094,
      "mae_dx": 0.0010418395977467299,
      "mae_dy": 0.0017422449309378862,
      "pose_mae_dtheta": 0.04404343664646149,
      "pose_mae_dx": 0.012863040901720524,
      "pose_mae_dy": 0.019083665683865547,
      "pose_rmse_dtheta": 0.08883345872163773,
      "pose_rmse_dx": 0.028885215520858765,
      "pose_rmse_dy": 0.041813354939222336,
      "pose_rmse_mean": 0.05317734181880951,
      "rmse_dtheta": 0.014445405453443527,
      "rmse_dx": 0.0031063188798725605,
      "rmse_dy": 0.0035029128193855286,
      "rmse_mean": 0.007018212229013443,
      "rotation_flip": 0.0040349699556827545,
      "sparse_tokens": 32153.0,
      "step": 8167,
      "turn_loss": 0.05859902873635292,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31466.0,
      "epoch": 0.37948336740382826,
      "grad_norm": 0.7090609073638916,
      "learning_rate": 2.3560125203769547e-06,
      "loss": 0.1501,
      "mae_dtheta": 0.02847117930650711,
      "mae_dx": 0.007935313507914543,
      "mae_dy": 0.005387832876294851,
      "pose_mae_dtheta": 0.19599246978759766,
      "pose_mae_dx": 0.07107505947351456,
      "pose_mae_dy": 0.06655099987983704,
      "pose_rmse_dtheta": 0.37304630875587463,
      "pose_rmse_dx": 0.1687052696943283,
      "pose_rmse_dy": 0.14119075238704681,
      "pose_rmse_mean": 0.22764745354652405,
      "rmse_dtheta": 0.045451339334249496,
      "rmse_dx": 0.01910168118774891,
      "rmse_dy": 0.009840790182352066,
      "rmse_mean": 0.024797936901450157,
      "rotation_flip": 0.00960878562182188,
      "sparse_tokens": 24112.0,
      "step": 8168,
      "turn_loss": 0.1824491024017334,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.37952982716967104,
      "grad_norm": 0.430225133895874,
      "learning_rate": 2.3548903819635845e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.019009992480278015,
      "mae_dx": 0.0036445348523557186,
      "mae_dy": 0.004650969989597797,
      "pose_mae_dtheta": 0.12508201599121094,
      "pose_mae_dx": 0.03099401667714119,
      "pose_mae_dy": 0.034840669482946396,
      "pose_rmse_dtheta": 0.24028874933719635,
      "pose_rmse_dx": 0.07444088160991669,
      "pose_rmse_dy": 0.06856170296669006,
      "pose_rmse_mean": 0.1277637779712677,
      "rmse_dtheta": 0.030600575730204582,
      "rmse_dx": 0.009519650600850582,
      "rmse_dy": 0.008626165799796581,
      "rmse_mean": 0.0162487979978323,
      "rotation_flip": 0.0139860138297081,
      "sparse_tokens": 4550.0,
      "step": 8169,
      "turn_loss": 0.15238189697265625,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3795762869355138,
      "grad_norm": 0.725946307182312,
      "learning_rate": 2.3537684285241474e-06,
      "loss": 0.1209,
      "mae_dtheta": 0.0063166930340230465,
      "mae_dx": 0.0009588593384250998,
      "mae_dy": 0.0016595374327152967,
      "pose_mae_dtheta": 0.04470338299870491,
      "pose_mae_dx": 0.013689529150724411,
      "pose_mae_dy": 0.024124890565872192,
      "pose_rmse_dtheta": 0.0952381044626236,
      "pose_rmse_dx": 0.038220811635255814,
      "pose_rmse_dy": 0.06440515071153641,
      "pose_rmse_mean": 0.06595468521118164,
      "rmse_dtheta": 0.0131905572488904,
      "rmse_dx": 0.003155238227918744,
      "rmse_dy": 0.0038117379881441593,
      "rmse_mean": 0.0067191775888204575,
      "rotation_flip": 0.002391200279816985,
      "sparse_tokens": 32057.0,
      "step": 8170,
      "turn_loss": 0.05476202070713043,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.37962274670135665,
      "grad_norm": 0.31446945667266846,
      "learning_rate": 2.3526466601371067e-06,
      "loss": 0.0704,
      "mae_dtheta": 0.008219013921916485,
      "mae_dx": 0.0013823065673932433,
      "mae_dy": 0.002006281865760684,
      "pose_mae_dtheta": 0.05631355568766594,
      "pose_mae_dx": 0.01777089573442936,
      "pose_mae_dy": 0.021325260400772095,
      "pose_rmse_dtheta": 0.18599484860897064,
      "pose_rmse_dx": 0.04374305158853531,
      "pose_rmse_dy": 0.05458320677280426,
      "pose_rmse_mean": 0.09477370977401733,
      "rmse_dtheta": 0.02173260785639286,
      "rmse_dx": 0.004111808259040117,
      "rmse_dy": 0.004563928581774235,
      "rmse_mean": 0.010136115364730358,
      "rotation_flip": 0.007731958758085966,
      "sparse_tokens": 32073.0,
      "step": 8171,
      "turn_loss": 0.06968661397695541,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.3796692064671994,
      "grad_norm": 0.4919341802597046,
      "learning_rate": 2.351525076880904e-06,
      "loss": 0.1215,
      "mae_dtheta": 0.006528218276798725,
      "mae_dx": 0.0013458790490403771,
      "mae_dy": 0.00023183574376162142,
      "pose_mae_dtheta": 0.045502495020627975,
      "pose_mae_dx": 0.0094215776771307,
      "pose_mae_dy": 0.002990779932588339,
      "pose_rmse_dtheta": 0.19007962942123413,
      "pose_rmse_dx": 0.022247008979320526,
      "pose_rmse_dy": 0.006200363393872976,
      "pose_rmse_mean": 0.07284233719110489,
      "rmse_dtheta": 0.024613479152321815,
      "rmse_dx": 0.0036434002686291933,
      "rmse_dy": 0.0005332123837433755,
      "rmse_mean": 0.009596697986125946,
      "rotation_flip": 0.001958224456757307,
      "sparse_tokens": 32217.0,
      "step": 8172,
      "turn_loss": 0.04289346933364868,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3797156662330422,
      "grad_norm": 0.34857213497161865,
      "learning_rate": 2.3504036788339763e-06,
      "loss": 0.0911,
      "mae_dtheta": 0.009882803075015545,
      "mae_dx": 0.0015826781746000051,
      "mae_dy": 0.0016589233418926597,
      "pose_mae_dtheta": 0.06063219532370567,
      "pose_mae_dx": 0.018534984439611435,
      "pose_mae_dy": 0.017566848546266556,
      "pose_rmse_dtheta": 0.19448034465312958,
      "pose_rmse_dx": 0.048334937542676926,
      "pose_rmse_dy": 0.04319755360484123,
      "pose_rmse_mean": 0.09533761441707611,
      "rmse_dtheta": 0.02521786279976368,
      "rmse_dx": 0.005366492085158825,
      "rmse_dy": 0.003670761827379465,
      "rmse_mean": 0.011418372392654419,
      "rotation_flip": 0.0023538642562925816,
      "sparse_tokens": 32153.0,
      "step": 8173,
      "turn_loss": 0.08006473630666733,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.379762125998885,
      "grad_norm": 0.31772446632385254,
      "learning_rate": 2.3492824660747395e-06,
      "loss": 0.0696,
      "mae_dtheta": 0.009209830313920975,
      "mae_dx": 0.0019856239669024944,
      "mae_dy": 0.0022769274655729532,
      "pose_mae_dtheta": 0.06125788390636444,
      "pose_mae_dx": 0.022847283631563187,
      "pose_mae_dy": 0.0268284622579813,
      "pose_rmse_dtheta": 0.1471143215894699,
      "pose_rmse_dx": 0.06831780076026917,
      "pose_rmse_dy": 0.07005076855421066,
      "pose_rmse_mean": 0.09516096115112305,
      "rmse_dtheta": 0.020290007814764977,
      "rmse_dx": 0.007525403052568436,
      "rmse_dy": 0.0054472205229103565,
      "rmse_mean": 0.01108754426240921,
      "rotation_flip": 0.00851221289485693,
      "sparse_tokens": 32105.0,
      "step": 8174,
      "turn_loss": 0.08792249113321304,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.37980858576472776,
      "grad_norm": 0.63313889503479,
      "learning_rate": 2.3481614386816043e-06,
      "loss": 0.1561,
      "mae_dtheta": 0.03276876360177994,
      "mae_dx": 0.00784736592322588,
      "mae_dy": 0.004969339817762375,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6331387758255005,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 149.8000946044922,
      "model/head/act_norm_mean": 105.77640474759616,
      "model/head/act_norm_min": 59.70594024658203,
      "model/head/act_over_embed": 72.69053563685166,
      "model/head/grad_frac": 0.10469461977481842,
      "model/head/grad_norm": 0.06628622114658356,
      "model/head/grad_zero_frac": 0.00019829485972877592,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6913812099358975,
      "model/head/update_ratio": 0.0011292895069345832,
      "model/head/weight_delta": 9.717968940734863,
      "model/head/weight_delta_rel": 0.17048196494579315,
      "model/head/weight_norm": 58.6972770690918,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4222846031188965,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222252368927002,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42216435074806213,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29015713572761087,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11426783353090286,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07234739512205124,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.549609375,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002336357720196247,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1002395153045654,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10129448771476746,
      "model/modality_embedder.encoders.pose/weight_norm": 30.965890884399414,
      "model/modality_embedder/grad_frac": 0.11426783353090286,
      "model/modality_embedder/grad_norm": 0.07234739512205124,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.549609375,
      "model/modality_embedder/update_ratio": 0.002336357720196247,
      "model/modality_embedder/weight_delta": 3.1002395153045654,
      "model/modality_embedder/weight_delta_rel": 0.10129448771476746,
      "model/modality_embedder/weight_norm": 30.965890884399414,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.5081558227539,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.277001933251935,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.441061019897461,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.996173651256257,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07389248162508011,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04678419604897499,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016749210190027952,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6106691360473633,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09513435512781143,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.932180404663086,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.61932373046875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.126400653744405,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.743633270263672,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.579888404174792,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0765516459941864,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.048467814922332764,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002975710085593164,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001630661659874022,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.30912184715271,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1146305650472641,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.722789764404297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.08073425292969,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.780569546194545,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.119173049926758,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.716648753639696,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08342840522527695,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05282175913453102,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001721051405183971,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5784711837768555,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1201583594083786,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.691564559936523,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.61605072021484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.63331807081807,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.13791275024414,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.989874885465955,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08811264485120773,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05578752979636192,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018648039549589157,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0668654441833496,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10481090843677521,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.91602897644043,
      "model/normalizer/grad_frac": 0.34175756573677063,
      "model/normalizer/grad_norm": 0.21637997031211853,
      "model/normalizer/grad_zero_frac": 0.00023752942797727883,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0027527667116373777,
      "model/normalizer/weight_delta": 6.46986198425293,
      "model/normalizer/weight_delta_rel": 0.08332807570695877,
      "model/normalizer/weight_norm": 78.60454559326172,
      "pose_mae_dtheta": 0.24231886863708496,
      "pose_mae_dx": 0.0657620057463646,
      "pose_mae_dy": 0.049551986157894135,
      "pose_rmse_dtheta": 0.424996018409729,
      "pose_rmse_dx": 0.17115545272827148,
      "pose_rmse_dy": 0.12511397898197174,
      "pose_rmse_mean": 0.2404218167066574,
      "rmse_dtheta": 0.051639948040246964,
      "rmse_dx": 0.01869054138660431,
      "rmse_dy": 0.010240835137665272,
      "rmse_mean": 0.026857107877731323,
      "rotation_flip": 0.014150943607091904,
      "sparse_tokens": 9494.0,
      "step": 8175,
      "turn_loss": 0.3010261356830597,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 27902.0,
      "epoch": 0.37985504553057053,
      "grad_norm": 1.0110434293746948,
      "learning_rate": 2.3470405967329605e-06,
      "loss": 0.2468,
      "mae_dtheta": 0.029256226494908333,
      "mae_dx": 0.010572845116257668,
      "mae_dy": 0.0036052640061825514,
      "pose_mae_dtheta": 0.20840135216712952,
      "pose_mae_dx": 0.08161695301532745,
      "pose_mae_dy": 0.04083063825964928,
      "pose_rmse_dtheta": 0.37697580456733704,
      "pose_rmse_dx": 0.200902059674263,
      "pose_rmse_dy": 0.0946735292673111,
      "pose_rmse_mean": 0.2241837978363037,
      "rmse_dtheta": 0.04600466415286064,
      "rmse_dx": 0.022628873586654663,
      "rmse_dy": 0.00799870677292347,
      "rmse_mean": 0.02554408274590969,
      "rotation_flip": 0.008600468747317791,
      "sparse_tokens": 21752.0,
      "step": 8176,
      "turn_loss": 0.25059381127357483,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3799015052964133,
      "grad_norm": 0.463356077671051,
      "learning_rate": 2.345919940307195e-06,
      "loss": 0.1173,
      "mae_dtheta": 0.007877329364418983,
      "mae_dx": 0.0014381262008100748,
      "mae_dy": 0.0011214088881388307,
      "pose_mae_dtheta": 0.04752819612622261,
      "pose_mae_dx": 0.016618890687823296,
      "pose_mae_dy": 0.015559853985905647,
      "pose_rmse_dtheta": 0.14224624633789062,
      "pose_rmse_dx": 0.04064127430319786,
      "pose_rmse_dy": 0.04526672884821892,
      "pose_rmse_mean": 0.07605142146348953,
      "rmse_dtheta": 0.021396439522504807,
      "rmse_dx": 0.004008804447948933,
      "rmse_dy": 0.0025543691590428352,
      "rmse_mean": 0.009319870732724667,
      "rotation_flip": 0.009727626107633114,
      "sparse_tokens": 32121.0,
      "step": 8177,
      "turn_loss": 0.06174899637699127,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 39790.0,
      "epoch": 0.3799479650622561,
      "grad_norm": 0.41732949018478394,
      "learning_rate": 2.34479946948267e-06,
      "loss": 0.1066,
      "mae_dtheta": 0.035607531666755676,
      "mae_dx": 0.015099159441888332,
      "mae_dy": 0.003906964790076017,
      "pose_mae_dtheta": 0.30683633685112,
      "pose_mae_dx": 0.12447565048933029,
      "pose_mae_dy": 0.05116981267929077,
      "pose_rmse_dtheta": 0.49796268343925476,
      "pose_rmse_dx": 0.28760069608688354,
      "pose_rmse_dy": 0.11754585057497025,
      "pose_rmse_mean": 0.30103641748428345,
      "rmse_dtheta": 0.052560411393642426,
      "rmse_dx": 0.029504554346203804,
      "rmse_dy": 0.008003036491572857,
      "rmse_mean": 0.030022665858268738,
      "rotation_flip": 0.01430030632764101,
      "sparse_tokens": 29890.0,
      "step": 8178,
      "turn_loss": 0.27183035016059875,
      "turns": 123.0,
      "turns_per_sample": 123.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.37999442482809886,
      "grad_norm": 0.38885340094566345,
      "learning_rate": 2.343679184337745e-06,
      "loss": 0.0968,
      "mae_dtheta": 0.01076230127364397,
      "mae_dx": 0.0021384151186794043,
      "mae_dy": 0.0021204210352152586,
      "pose_mae_dtheta": 0.06839583814144135,
      "pose_mae_dx": 0.02357792668044567,
      "pose_mae_dy": 0.020895853638648987,
      "pose_rmse_dtheta": 0.21275769174098969,
      "pose_rmse_dx": 0.062389712780714035,
      "pose_rmse_dy": 0.04963592067360878,
      "pose_rmse_mean": 0.1082611083984375,
      "rmse_dtheta": 0.025986595079302788,
      "rmse_dx": 0.006177900824695826,
      "rmse_dy": 0.005283102858811617,
      "rmse_mean": 0.012482533231377602,
      "rotation_flip": 0.006688963156193495,
      "sparse_tokens": 32105.0,
      "step": 8179,
      "turn_loss": 0.09864747524261475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.38004088459394164,
      "grad_norm": 0.43321239948272705,
      "learning_rate": 2.3425590849507585e-06,
      "loss": 0.1116,
      "mae_dtheta": 0.006940866820514202,
      "mae_dx": 0.0028111084830015898,
      "mae_dy": 0.0009329391177743673,
      "pose_mae_dtheta": 0.0452398881316185,
      "pose_mae_dx": 0.026680653914809227,
      "pose_mae_dy": 0.011164951138198376,
      "pose_rmse_dtheta": 0.1922481209039688,
      "pose_rmse_dx": 0.1208990067243576,
      "pose_rmse_dy": 0.03544071316719055,
      "pose_rmse_mean": 0.11619594693183899,
      "rmse_dtheta": 0.0247195977717638,
      "rmse_dx": 0.011138156056404114,
      "rmse_dy": 0.0032780191395431757,
      "rmse_mean": 0.01304525788873434,
      "rotation_flip": 0.00365408044308424,
      "sparse_tokens": 32137.0,
      "step": 8180,
      "turn_loss": 0.07700903713703156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3800873443597844,
      "grad_norm": 0.2743268311023712,
      "learning_rate": 2.3414391714000435e-06,
      "loss": 0.0674,
      "mae_dtheta": 0.012624611146748066,
      "mae_dx": 0.002160320756956935,
      "mae_dy": 0.002541585126891732,
      "pose_mae_dtheta": 0.08200804144144058,
      "pose_mae_dx": 0.024538474157452583,
      "pose_mae_dy": 0.032695598900318146,
      "pose_rmse_dtheta": 0.1716231405735016,
      "pose_rmse_dx": 0.06109199672937393,
      "pose_rmse_dy": 0.07123617827892303,
      "pose_rmse_mean": 0.10131710767745972,
      "rmse_dtheta": 0.024811597540974617,
      "rmse_dx": 0.00635387422516942,
      "rmse_dy": 0.005417164880782366,
      "rmse_mean": 0.012194212526082993,
      "rotation_flip": 0.007470651064068079,
      "sparse_tokens": 32137.0,
      "step": 8181,
      "turn_loss": 0.11094360798597336,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.3801338041256272,
      "grad_norm": 0.9577188491821289,
      "learning_rate": 2.340319443763912e-06,
      "loss": 0.2396,
      "mae_dtheta": 0.03199964016675949,
      "mae_dx": 0.014308777637779713,
      "mae_dy": 0.005605620332062244,
      "pose_mae_dtheta": 0.25083932280540466,
      "pose_mae_dx": 0.1172281876206398,
      "pose_mae_dy": 0.05205829441547394,
      "pose_rmse_dtheta": 0.4358738958835602,
      "pose_rmse_dx": 0.26857441663742065,
      "pose_rmse_dy": 0.12330035120248795,
      "pose_rmse_mean": 0.2759162485599518,
      "rmse_dtheta": 0.0489661879837513,
      "rmse_dx": 0.028970403596758842,
      "rmse_dy": 0.01188635267317295,
      "rmse_mean": 0.029940981417894363,
      "rotation_flip": 0.01545253861695528,
      "sparse_tokens": 16701.0,
      "step": 8182,
      "turn_loss": 0.2530379593372345,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.38018026389146997,
      "grad_norm": 0.42055293917655945,
      "learning_rate": 2.339199902120672e-06,
      "loss": 0.0965,
      "mae_dtheta": 0.013119123876094818,
      "mae_dx": 0.0015220011118799448,
      "mae_dy": 0.002100013429298997,
      "pose_mae_dtheta": 0.08391787856817245,
      "pose_mae_dx": 0.02128569968044758,
      "pose_mae_dy": 0.032199688255786896,
      "pose_rmse_dtheta": 0.20567281544208527,
      "pose_rmse_dx": 0.05041089281439781,
      "pose_rmse_dy": 0.0779489204287529,
      "pose_rmse_mean": 0.11134421080350876,
      "rmse_dtheta": 0.028251558542251587,
      "rmse_dx": 0.004417310003191233,
      "rmse_dy": 0.004221790470182896,
      "rmse_mean": 0.01229688711464405,
      "rotation_flip": 0.0032834731973707676,
      "sparse_tokens": 32137.0,
      "step": 8183,
      "turn_loss": 0.09759308397769928,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.38022672365731275,
      "grad_norm": 0.4108143448829651,
      "learning_rate": 2.3380805465486085e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.03353476524353027,
      "mae_dx": 0.011089947074651718,
      "mae_dy": 0.005633745342493057,
      "pose_mae_dtheta": 0.25766971707344055,
      "pose_mae_dx": 0.09595652669668198,
      "pose_mae_dy": 0.06154116243124008,
      "pose_rmse_dtheta": 0.42652595043182373,
      "pose_rmse_dx": 0.21383562684059143,
      "pose_rmse_dy": 0.13628442585468292,
      "pose_rmse_mean": 0.25888198614120483,
      "rmse_dtheta": 0.04884357750415802,
      "rmse_dx": 0.02293848618865013,
      "rmse_dy": 0.011114366352558136,
      "rmse_mean": 0.02763214521110058,
      "rotation_flip": 0.011754068545997143,
      "sparse_tokens": 18129.0,
      "step": 8184,
      "turn_loss": 0.301803857088089,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3802731834231555,
      "grad_norm": 0.3698371648788452,
      "learning_rate": 2.3369613771260006e-06,
      "loss": 0.0608,
      "mae_dtheta": 0.00732104666531086,
      "mae_dx": 0.0012981020845472813,
      "mae_dy": 0.0018012829823419452,
      "pose_mae_dtheta": 0.04616269841790199,
      "pose_mae_dx": 0.015530730597674847,
      "pose_mae_dy": 0.019197938963770866,
      "pose_rmse_dtheta": 0.09911837428808212,
      "pose_rmse_dx": 0.04353850334882736,
      "pose_rmse_dy": 0.045398399233818054,
      "pose_rmse_mean": 0.06268509477376938,
      "rmse_dtheta": 0.016416359692811966,
      "rmse_dx": 0.004049086477607489,
      "rmse_dy": 0.0043729087337851524,
      "rmse_mean": 0.008279452100396156,
      "rotation_flip": 0.006080449093133211,
      "sparse_tokens": 32073.0,
      "step": 8185,
      "turn_loss": 0.06416446715593338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.3803196431889983,
      "grad_norm": 0.6369548439979553,
      "learning_rate": 2.335842393931116e-06,
      "loss": 0.1537,
      "mae_dtheta": 0.041185878217220306,
      "mae_dx": 0.013579277321696281,
      "mae_dy": 0.015516672283411026,
      "pose_mae_dtheta": 0.3116992712020874,
      "pose_mae_dx": 0.10618799924850464,
      "pose_mae_dy": 0.16303902864456177,
      "pose_rmse_dtheta": 0.5260064005851746,
      "pose_rmse_dx": 0.19751542806625366,
      "pose_rmse_dy": 0.3301014006137848,
      "pose_rmse_mean": 0.3512077331542969,
      "rmse_dtheta": 0.06138287112116814,
      "rmse_dx": 0.024894628673791885,
      "rmse_dy": 0.02675393968820572,
      "rmse_mean": 0.03767714649438858,
      "rotation_flip": 0.021238937973976135,
      "sparse_tokens": 8884.0,
      "step": 8186,
      "turn_loss": 0.45526123046875,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.38036610295484113,
      "grad_norm": 1.2395602464675903,
      "learning_rate": 2.3347235970422e-06,
      "loss": 0.2642,
      "mae_dtheta": 0.03601238131523132,
      "mae_dx": 0.00920887477695942,
      "mae_dy": 0.005503463093191385,
      "pose_mae_dtheta": 0.2884678542613983,
      "pose_mae_dx": 0.059397611767053604,
      "pose_mae_dy": 0.06866747885942459,
      "pose_rmse_dtheta": 0.5575463175773621,
      "pose_rmse_dx": 0.13110476732254028,
      "pose_rmse_dy": 0.17601360380649567,
      "pose_rmse_mean": 0.2882215678691864,
      "rmse_dtheta": 0.05795913562178612,
      "rmse_dx": 0.019781427457928658,
      "rmse_dy": 0.010675640776753426,
      "rmse_mean": 0.029472067952156067,
      "rotation_flip": 0.008368200622498989,
      "sparse_tokens": 8118.0,
      "step": 8187,
      "turn_loss": 0.2449704110622406,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3804125627206839,
      "grad_norm": 0.44428038597106934,
      "learning_rate": 2.3336049865374954e-06,
      "loss": 0.1257,
      "mae_dtheta": 0.006892411038279533,
      "mae_dx": 0.0011030581081286073,
      "mae_dy": 0.0011975091183558106,
      "pose_mae_dtheta": 0.049680761992931366,
      "pose_mae_dx": 0.013956301845610142,
      "pose_mae_dy": 0.019241252914071083,
      "pose_rmse_dtheta": 0.13199983537197113,
      "pose_rmse_dx": 0.035317447036504745,
      "pose_rmse_dy": 0.046336494386196136,
      "pose_rmse_mean": 0.07121792435646057,
      "rmse_dtheta": 0.017779793590307236,
      "rmse_dx": 0.0036835677456110716,
      "rmse_dy": 0.0023904757108539343,
      "rmse_mean": 0.007951279170811176,
      "rotation_flip": 0.0015220700297504663,
      "sparse_tokens": 32153.0,
      "step": 8188,
      "turn_loss": 0.05659715086221695,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.3804590224865267,
      "grad_norm": 0.6131642460823059,
      "learning_rate": 2.3324865624952236e-06,
      "loss": 0.1542,
      "mae_dtheta": 0.02658522129058838,
      "mae_dx": 0.00511033833026886,
      "mae_dy": 0.003557964926585555,
      "pose_mae_dtheta": 0.1789754182100296,
      "pose_mae_dx": 0.032818615436553955,
      "pose_mae_dy": 0.04408271610736847,
      "pose_rmse_dtheta": 0.3921348452568054,
      "pose_rmse_dx": 0.08316418528556824,
      "pose_rmse_dy": 0.11394211649894714,
      "pose_rmse_mean": 0.19641372561454773,
      "rmse_dtheta": 0.04806056618690491,
      "rmse_dx": 0.014272546395659447,
      "rmse_dy": 0.007129226811230183,
      "rmse_mean": 0.023154115304350853,
      "rotation_flip": 0.00561797758564353,
      "sparse_tokens": 3134.0,
      "step": 8189,
      "turn_loss": 0.12097961455583572,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.38050548225236946,
      "grad_norm": 0.48732897639274597,
      "learning_rate": 2.3313683249935986e-06,
      "loss": 0.0873,
      "mae_dtheta": 0.008442070335149765,
      "mae_dx": 0.0013964284444227815,
      "mae_dy": 0.0014898693189024925,
      "pose_mae_dtheta": 0.05538719892501831,
      "pose_mae_dx": 0.016253653913736343,
      "pose_mae_dy": 0.019205622375011444,
      "pose_rmse_dtheta": 0.145921528339386,
      "pose_rmse_dx": 0.039669960737228394,
      "pose_rmse_dy": 0.04627802222967148,
      "pose_rmse_mean": 0.07728984206914902,
      "rmse_dtheta": 0.021087292581796646,
      "rmse_dx": 0.0045282370410859585,
      "rmse_dy": 0.003245660336688161,
      "rmse_mean": 0.009620397351682186,
      "rotation_flip": 0.0022461814805865288,
      "sparse_tokens": 32073.0,
      "step": 8190,
      "turn_loss": 0.0604255273938179,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.38055194201821224,
      "grad_norm": 1.1258738040924072,
      "learning_rate": 2.33025027411082e-06,
      "loss": 0.2817,
      "mae_dtheta": 0.04175804182887077,
      "mae_dx": 0.015155754052102566,
      "mae_dy": 0.007108372636139393,
      "pose_mae_dtheta": 0.3382333517074585,
      "pose_mae_dx": 0.11534762382507324,
      "pose_mae_dy": 0.07656633108854294,
      "pose_rmse_dtheta": 0.5327630043029785,
      "pose_rmse_dx": 0.25340309739112854,
      "pose_rmse_dy": 0.16483549773693085,
      "pose_rmse_mean": 0.31700053811073303,
      "rmse_dtheta": 0.05782700702548027,
      "rmse_dx": 0.02833203412592411,
      "rmse_dy": 0.013879763893783092,
      "rmse_mean": 0.0333462692797184,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 11533.0,
      "step": 8191,
      "turn_loss": 0.41622021794319153,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.380598401784055,
      "grad_norm": 0.5432737469673157,
      "learning_rate": 2.329132409925072e-06,
      "loss": 0.1313,
      "mae_dtheta": 0.011691514402627945,
      "mae_dx": 0.0035423419903963804,
      "mae_dy": 0.0044221156276762486,
      "pose_mae_dtheta": 0.07942934334278107,
      "pose_mae_dx": 0.03471602872014046,
      "pose_mae_dy": 0.03505687043070793,
      "pose_rmse_dtheta": 0.16048939526081085,
      "pose_rmse_dx": 0.07802152633666992,
      "pose_rmse_dy": 0.08330629020929337,
      "pose_rmse_mean": 0.10727240890264511,
      "rmse_dtheta": 0.022757206112146378,
      "rmse_dx": 0.008764726109802723,
      "rmse_dy": 0.010122418403625488,
      "rmse_mean": 0.013881450518965721,
      "rotation_flip": 0.0077797723934054375,
      "sparse_tokens": 32185.0,
      "step": 8192,
      "turn_loss": 0.14478586614131927,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.3806448615498978,
      "grad_norm": 0.5784274339675903,
      "learning_rate": 2.3280147325145285e-06,
      "loss": 0.098,
      "mae_dtheta": 0.03271159157156944,
      "mae_dx": 0.011115497909486294,
      "mae_dy": 0.004007251933217049,
      "pose_mae_dtheta": 0.24798165261745453,
      "pose_mae_dx": 0.09980923682451248,
      "pose_mae_dy": 0.06035269424319267,
      "pose_rmse_dtheta": 0.40003296732902527,
      "pose_rmse_dx": 0.2108837217092514,
      "pose_rmse_dy": 0.13855254650115967,
      "pose_rmse_mean": 0.24982307851314545,
      "rmse_dtheta": 0.04817143455147743,
      "rmse_dx": 0.022174343466758728,
      "rmse_dy": 0.007500530686229467,
      "rmse_mean": 0.025948768481612206,
      "rotation_flip": 0.020661156624555588,
      "sparse_tokens": 7884.0,
      "step": 8193,
      "turn_loss": 0.24537132680416107,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.38069132131574057,
      "grad_norm": 0.6633513569831848,
      "learning_rate": 2.326897241957348e-06,
      "loss": 0.1735,
      "mae_dtheta": 0.04054498299956322,
      "mae_dx": 0.011573802679777145,
      "mae_dy": 0.00537859508767724,
      "pose_mae_dtheta": 0.34520795941352844,
      "pose_mae_dx": 0.10565213859081268,
      "pose_mae_dy": 0.0645311027765274,
      "pose_rmse_dtheta": 0.5515480041503906,
      "pose_rmse_dx": 0.20755720138549805,
      "pose_rmse_dy": 0.16293948888778687,
      "pose_rmse_mean": 0.30734825134277344,
      "rmse_dtheta": 0.05643007531762123,
      "rmse_dx": 0.022829264402389526,
      "rmse_dy": 0.011290992610156536,
      "rmse_mean": 0.030183441936969757,
      "rotation_flip": 0.009416195563971996,
      "sparse_tokens": 8930.0,
      "step": 8194,
      "turn_loss": 0.274448037147522,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.38073778108158335,
      "grad_norm": 0.8720234036445618,
      "learning_rate": 2.32577993833168e-06,
      "loss": 0.2338,
      "mae_dtheta": 0.038762111216783524,
      "mae_dx": 0.011556542478501797,
      "mae_dy": 0.0031690436881035566,
      "pose_mae_dtheta": 0.3102358281612396,
      "pose_mae_dx": 0.08466542512178421,
      "pose_mae_dy": 0.0418744720518589,
      "pose_rmse_dtheta": 0.4725177586078644,
      "pose_rmse_dx": 0.1722649484872818,
      "pose_rmse_dy": 0.1097598597407341,
      "pose_rmse_mean": 0.251514196395874,
      "rmse_dtheta": 0.054925717413425446,
      "rmse_dx": 0.022510673850774765,
      "rmse_dy": 0.007117984350770712,
      "rmse_mean": 0.028184792026877403,
      "rotation_flip": 0.01138519961386919,
      "sparse_tokens": 8362.0,
      "step": 8195,
      "turn_loss": 0.2701686918735504,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.3807842408474261,
      "grad_norm": 0.41785624623298645,
      "learning_rate": 2.3246628217156536e-06,
      "loss": 0.1086,
      "mae_dtheta": 0.028115198016166687,
      "mae_dx": 0.008187941275537014,
      "mae_dy": 0.004045545589178801,
      "pose_mae_dtheta": 0.20779523253440857,
      "pose_mae_dx": 0.07319235801696777,
      "pose_mae_dy": 0.038508377969264984,
      "pose_rmse_dtheta": 0.37462490797042847,
      "pose_rmse_dx": 0.15645845234394073,
      "pose_rmse_dy": 0.07524533569812775,
      "pose_rmse_mean": 0.20210956037044525,
      "rmse_dtheta": 0.04343338683247566,
      "rmse_dx": 0.017999442294239998,
      "rmse_dy": 0.008586090058088303,
      "rmse_mean": 0.023339640349149704,
      "rotation_flip": 0.007544006686657667,
      "sparse_tokens": 20445.0,
      "step": 8196,
      "turn_loss": 0.21451853215694427,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 26204.0,
      "epoch": 0.3808307006132689,
      "grad_norm": 0.561190128326416,
      "learning_rate": 2.323545892187393e-06,
      "loss": 0.1748,
      "mae_dtheta": 0.03731338679790497,
      "mae_dx": 0.012999641709029675,
      "mae_dy": 0.005739334039390087,
      "pose_mae_dtheta": 0.2806968092918396,
      "pose_mae_dx": 0.1008775383234024,
      "pose_mae_dy": 0.07193128019571304,
      "pose_rmse_dtheta": 0.4544227719306946,
      "pose_rmse_dx": 0.20640875399112701,
      "pose_rmse_dy": 0.1677188277244568,
      "pose_rmse_mean": 0.27618345618247986,
      "rmse_dtheta": 0.054164547473192215,
      "rmse_dx": 0.025077762082219124,
      "rmse_dy": 0.010236951522529125,
      "rmse_mean": 0.029826421290636063,
      "rotation_flip": 0.013452914543449879,
      "sparse_tokens": 19838.0,
      "step": 8197,
      "turn_loss": 0.30896514654159546,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 2949.0,
      "epoch": 0.3808771603791117,
      "grad_norm": 0.6677164435386658,
      "learning_rate": 2.3224291498250056e-06,
      "loss": 0.1922,
      "mae_dtheta": 0.043340735137462616,
      "mae_dx": 0.023185420781373978,
      "mae_dy": 0.015571525320410728,
      "pose_mae_dtheta": 0.29861992597579956,
      "pose_mae_dx": 0.145537868142128,
      "pose_mae_dy": 0.16085080802440643,
      "pose_rmse_dtheta": 0.4521452784538269,
      "pose_rmse_dx": 0.2820313572883606,
      "pose_rmse_dy": 0.2874724268913269,
      "pose_rmse_mean": 0.3405497074127197,
      "rmse_dtheta": 0.06091760843992233,
      "rmse_dx": 0.03751455619931221,
      "rmse_dy": 0.02369461953639984,
      "rmse_mean": 0.04070892930030823,
      "rotation_flip": 0.0,
      "sparse_tokens": 2309.0,
      "step": 8198,
      "turn_loss": 0.7332301735877991,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 26931.0,
      "epoch": 0.38092362014495446,
      "grad_norm": 0.6324502825737,
      "learning_rate": 2.321312594706584e-06,
      "loss": 0.1761,
      "mae_dtheta": 0.02504364214837551,
      "mae_dx": 0.01002805121243,
      "mae_dy": 0.004367365967482328,
      "pose_mae_dtheta": 0.17366693913936615,
      "pose_mae_dx": 0.08100468665361404,
      "pose_mae_dy": 0.05530482530593872,
      "pose_rmse_dtheta": 0.3254903256893158,
      "pose_rmse_dx": 0.19594129920005798,
      "pose_rmse_dy": 0.12566335499286652,
      "pose_rmse_mean": 0.21569833159446716,
      "rmse_dtheta": 0.0409272126853466,
      "rmse_dx": 0.022777698934078217,
      "rmse_dy": 0.008497127331793308,
      "rmse_mean": 0.02406734600663185,
      "rotation_flip": 0.01279707532376051,
      "sparse_tokens": 20816.0,
      "step": 8199,
      "turn_loss": 0.18856704235076904,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.38097007991079723,
      "grad_norm": 0.4054221212863922,
      "learning_rate": 2.3201962269102118e-06,
      "loss": 0.0915,
      "mae_dtheta": 0.008375927805900574,
      "mae_dx": 0.0013775748666375875,
      "mae_dy": 0.002260817913338542,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4054220914840698,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.2945556640625,
      "model/head/act_norm_mean": 111.03481100063131,
      "model/head/act_norm_min": 59.63420104980469,
      "model/head/act_over_embed": 76.3041616439124,
      "model/head/grad_frac": 0.11557511240243912,
      "model/head/grad_norm": 0.046856705099344254,
      "model/head/grad_zero_frac": 0.00015387681196443737,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7068586253156566,
      "model/head/update_ratio": 0.0007982662064023316,
      "model/head/weight_delta": 9.72254753112793,
      "model/head/weight_delta_rel": 0.170562282204628,
      "model/head/weight_norm": 58.69809341430664,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4222998023033142,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42222961007732235,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42214053869247437,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901601410210256,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09555663168430328,
      "model/modality_embedder.encoders.pose/grad_norm": 0.038740769028663635,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5381528253424658,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012510741362348199,
      "model/modality_embedder.encoders.pose/weight_delta": 3.103027105331421,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10138556361198425,
      "model/modality_embedder.encoders.pose/weight_norm": 30.966007232666016,
      "model/modality_embedder/grad_frac": 0.09555663168430328,
      "model/modality_embedder/grad_norm": 0.038740769028663635,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5381528253424658,
      "model/modality_embedder/update_ratio": 0.0012510741362348199,
      "model/modality_embedder/weight_delta": 3.103027105331421,
      "model/modality_embedder/weight_delta_rel": 0.10138556361198425,
      "model/modality_embedder/weight_norm": 30.966007232666016,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.08160400390625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.705249418791084,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.115082740783691,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.29046933263489,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08702807128429413,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.035283103585243225,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012631670106202364,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6126270294189453,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09520570188760757,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.932254791259766,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.9296646118164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.685480800064134,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.26979923248291,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.964093514916506,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09069918841123581,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03677145391702652,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012371147749945521,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.312373399734497,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1147432029247284,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.72355842590332,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.54328155517578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.517118105659772,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.195775032043457,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.222811819380457,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09867843240499496,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04000641778111458,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013034566072747111,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5823261737823486,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12028780579566956,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.69255828857422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.1795425415039,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.26568011463845,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.791102409362793,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.42444000224605,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10571069270372391,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04285744950175285,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014325679512694478,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.070171594619751,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10492389649152756,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.916521072387695,
      "model/normalizer/grad_frac": 0.404110848903656,
      "model/normalizer/grad_norm": 0.16383546590805054,
      "model/normalizer/grad_zero_frac": 0.00017962424317374825,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020842798985540867,
      "model/normalizer/weight_delta": 6.476315021514893,
      "model/normalizer/weight_delta_rel": 0.08341118693351746,
      "model/normalizer/weight_norm": 78.60530853271484,
      "pose_mae_dtheta": 0.05690760537981987,
      "pose_mae_dx": 0.016682792454957962,
      "pose_mae_dy": 0.022713931277394295,
      "pose_rmse_dtheta": 0.13769321143627167,
      "pose_rmse_dx": 0.060433194041252136,
      "pose_rmse_dy": 0.05433246120810509,
      "pose_rmse_mean": 0.0841529592871666,
      "rmse_dtheta": 0.019459543749690056,
      "rmse_dx": 0.00444230018183589,
      "rmse_dy": 0.005738263484090567,
      "rmse_mean": 0.009880036115646362,
      "rotation_flip": 0.0035516968928277493,
      "sparse_tokens": 32073.0,
      "step": 8200,
      "turn_loss": 0.07388950884342194,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.38097007991079723,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3013087809085846,
      "eval_objectnav_nopose_mae_dtheta": 0.039632346481084824,
      "eval_objectnav_nopose_mae_dx": 0.013409226201474667,
      "eval_objectnav_nopose_mae_dy": 0.004802971612662077,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31682437658309937,
      "eval_objectnav_nopose_pose_mae_dx": 0.10696306079626083,
      "eval_objectnav_nopose_pose_mae_dy": 0.05479671433568001,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5349177718162537,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23484215140342712,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12890563905239105,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2995551824569702,
      "eval_objectnav_nopose_rmse_dtheta": 0.05729566141963005,
      "eval_objectnav_nopose_rmse_dx": 0.026209531351923943,
      "eval_objectnav_nopose_rmse_dy": 0.009711824357509613,
      "eval_objectnav_nopose_rmse_mean": 0.031072339043021202,
      "eval_objectnav_nopose_rotation_flip": 0.015829509124159813,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3013087809085846,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 8200
    },
    {
      "epoch": 0.38097007991079723,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2725954055786133,
      "eval_objectnav_pose_mae_dtheta": 0.03475843369960785,
      "eval_objectnav_pose_mae_dx": 0.011365832760930061,
      "eval_objectnav_pose_mae_dy": 0.004485584795475006,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2623012661933899,
      "eval_objectnav_pose_pose_mae_dx": 0.08977042883634567,
      "eval_objectnav_pose_pose_mae_dy": 0.047855060547590256,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45708996057510376,
      "eval_objectnav_pose_pose_rmse_dx": 0.20759950578212738,
      "eval_objectnav_pose_pose_rmse_dy": 0.1111471951007843,
      "eval_objectnav_pose_pose_rmse_mean": 0.2586122453212738,
      "eval_objectnav_pose_rmse_dtheta": 0.05214698612689972,
      "eval_objectnav_pose_rmse_dx": 0.02355603501200676,
      "eval_objectnav_pose_rmse_dy": 0.009075342677533627,
      "eval_objectnav_pose_rmse_mean": 0.028259456157684326,
      "eval_objectnav_pose_rotation_flip": 0.01590716280043125,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2725954055786133,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 8200
    },
    {
      "epoch": 0.38097007991079723,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08945265412330627,
      "eval_pointnav_mae_dtheta": 0.01027851365506649,
      "eval_pointnav_mae_dx": 0.002374114468693733,
      "eval_pointnav_mae_dy": 0.002381701720878482,
      "eval_pointnav_pose_mae_dtheta": 0.07053013145923615,
      "eval_pointnav_pose_mae_dx": 0.026272274553775787,
      "eval_pointnav_pose_mae_dy": 0.02544206567108631,
      "eval_pointnav_pose_rmse_dtheta": 0.20555756986141205,
      "eval_pointnav_pose_rmse_dx": 0.0824870616197586,
      "eval_pointnav_pose_rmse_dy": 0.07495236396789551,
      "eval_pointnav_pose_rmse_mean": 0.12099900096654892,
      "eval_pointnav_rmse_dtheta": 0.02527218870818615,
      "eval_pointnav_rmse_dx": 0.007605500984936953,
      "eval_pointnav_rmse_dy": 0.006475729867815971,
      "eval_pointnav_rmse_mean": 0.013117807917296886,
      "eval_pointnav_rotation_flip": 0.004783517215400934,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08945265412330627,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 8200
    },
    {
      "epoch": 0.38097007991079723,
      "eval_loss": 0.22111894687016806,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3013087809085846,
      "eval_objectnav_nopose_mae_dtheta": 0.039632346481084824,
      "eval_objectnav_nopose_mae_dx": 0.013409226201474667,
      "eval_objectnav_nopose_mae_dy": 0.004802971612662077,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31682437658309937,
      "eval_objectnav_nopose_pose_mae_dx": 0.10696306079626083,
      "eval_objectnav_nopose_pose_mae_dy": 0.05479671433568001,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5349177718162537,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23484215140342712,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12890563905239105,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2995551824569702,
      "eval_objectnav_nopose_rmse_dtheta": 0.05729566141963005,
      "eval_objectnav_nopose_rmse_dx": 0.026209531351923943,
      "eval_objectnav_nopose_rmse_dy": 0.009711824357509613,
      "eval_objectnav_nopose_rmse_mean": 0.031072339043021202,
      "eval_objectnav_nopose_rotation_flip": 0.015829509124159813,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3013087809085846,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2725954055786133,
      "eval_objectnav_pose_mae_dtheta": 0.03475843369960785,
      "eval_objectnav_pose_mae_dx": 0.011365832760930061,
      "eval_objectnav_pose_mae_dy": 0.004485584795475006,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2623012661933899,
      "eval_objectnav_pose_pose_mae_dx": 0.08977042883634567,
      "eval_objectnav_pose_pose_mae_dy": 0.047855060547590256,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45708996057510376,
      "eval_objectnav_pose_pose_rmse_dx": 0.20759950578212738,
      "eval_objectnav_pose_pose_rmse_dy": 0.1111471951007843,
      "eval_objectnav_pose_pose_rmse_mean": 0.2586122453212738,
      "eval_objectnav_pose_rmse_dtheta": 0.05214698612689972,
      "eval_objectnav_pose_rmse_dx": 0.02355603501200676,
      "eval_objectnav_pose_rmse_dy": 0.009075342677533627,
      "eval_objectnav_pose_rmse_mean": 0.028259456157684326,
      "eval_objectnav_pose_rotation_flip": 0.01590716280043125,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2725954055786133,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08945265412330627,
      "eval_pointnav_mae_dtheta": 0.01027851365506649,
      "eval_pointnav_mae_dx": 0.002374114468693733,
      "eval_pointnav_mae_dy": 0.002381701720878482,
      "eval_pointnav_pose_mae_dtheta": 0.07053013145923615,
      "eval_pointnav_pose_mae_dx": 0.026272274553775787,
      "eval_pointnav_pose_mae_dy": 0.02544206567108631,
      "eval_pointnav_pose_rmse_dtheta": 0.20555756986141205,
      "eval_pointnav_pose_rmse_dx": 0.0824870616197586,
      "eval_pointnav_pose_rmse_dy": 0.07495236396789551,
      "eval_pointnav_pose_rmse_mean": 0.12099900096654892,
      "eval_pointnav_rmse_dtheta": 0.02527218870818615,
      "eval_pointnav_rmse_dx": 0.007605500984936953,
      "eval_pointnav_rmse_dy": 0.006475729867815971,
      "eval_pointnav_rmse_mean": 0.013117807917296886,
      "eval_pointnav_rotation_flip": 0.004783517215400934,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08945265412330627,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 8200
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.38101653967664,
      "grad_norm": 0.5859295129776001,
      "learning_rate": 2.319080046513954e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.00761382607743144,
      "mae_dx": 0.0023272684775292873,
      "mae_dy": 0.003016743343323469,
      "pose_mae_dtheta": 0.052634891122579575,
      "pose_mae_dx": 0.025959348306059837,
      "pose_mae_dy": 0.024054985493421555,
      "pose_rmse_dtheta": 0.12712329626083374,
      "pose_rmse_dx": 0.07292827218770981,
      "pose_rmse_dy": 0.053085993975400925,
      "pose_rmse_mean": 0.08437918871641159,
      "rmse_dtheta": 0.017375078052282333,
      "rmse_dx": 0.005681246053427458,
      "rmse_dy": 0.007315953262150288,
      "rmse_mean": 0.010124092921614647,
      "rotation_flip": 0.0015455950051546097,
      "sparse_tokens": 32153.0,
      "step": 8201,
      "turn_loss": 0.08242695778608322,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.3810629994424828,
      "grad_norm": 0.48612529039382935,
      "learning_rate": 2.317964053595869e-06,
      "loss": 0.1072,
      "mae_dtheta": 0.02651095762848854,
      "mae_dx": 0.016022201627492905,
      "mae_dy": 0.00534953223541379,
      "pose_mae_dtheta": 0.19724859297275543,
      "pose_mae_dx": 0.12334878742694855,
      "pose_mae_dy": 0.07997293025255203,
      "pose_rmse_dtheta": 0.3959622383117676,
      "pose_rmse_dx": 0.273027241230011,
      "pose_rmse_dy": 0.1940155178308487,
      "pose_rmse_mean": 0.2876683473587036,
      "rmse_dtheta": 0.045253582298755646,
      "rmse_dx": 0.030775481835007668,
      "rmse_dy": 0.011338084936141968,
      "rmse_mean": 0.029122382402420044,
      "rotation_flip": 0.012589927762746811,
      "sparse_tokens": 12121.0,
      "step": 8202,
      "turn_loss": 0.22887085378170013,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.38110945920832556,
      "grad_norm": 0.7515823245048523,
      "learning_rate": 2.3168482482339955e-06,
      "loss": 0.1356,
      "mae_dtheta": 0.03296440467238426,
      "mae_dx": 0.01374130044132471,
      "mae_dy": 0.004198993556201458,
      "pose_mae_dtheta": 0.2605142593383789,
      "pose_mae_dx": 0.10471545904874802,
      "pose_mae_dy": 0.061476290225982666,
      "pose_rmse_dtheta": 0.48199594020843506,
      "pose_rmse_dx": 0.2389640361070633,
      "pose_rmse_dy": 0.14582082629203796,
      "pose_rmse_mean": 0.2889269292354584,
      "rmse_dtheta": 0.051856208592653275,
      "rmse_dx": 0.0276829544454813,
      "rmse_dy": 0.007402983959764242,
      "rmse_mean": 0.028980717062950134,
      "rotation_flip": 0.018121911212801933,
      "sparse_tokens": 10868.0,
      "step": 8203,
      "turn_loss": 0.21241527795791626,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 35039.0,
      "epoch": 0.3811559189741684,
      "grad_norm": 0.5002584457397461,
      "learning_rate": 2.3157326305063645e-06,
      "loss": 0.1432,
      "mae_dtheta": 0.03010883368551731,
      "mae_dx": 0.012590544298291206,
      "mae_dy": 0.00422911299392581,
      "pose_mae_dtheta": 0.220065176486969,
      "pose_mae_dx": 0.10221382230520248,
      "pose_mae_dy": 0.047208912670612335,
      "pose_rmse_dtheta": 0.428981751203537,
      "pose_rmse_dx": 0.23908576369285583,
      "pose_rmse_dy": 0.11852417886257172,
      "pose_rmse_mean": 0.26219725608825684,
      "rmse_dtheta": 0.04937130585312843,
      "rmse_dx": 0.02593105472624302,
      "rmse_dy": 0.009123957715928555,
      "rmse_mean": 0.028142107650637627,
      "rotation_flip": 0.01264980062842369,
      "sparse_tokens": 27513.0,
      "step": 8204,
      "turn_loss": 0.24063558876514435,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 62864.0,
      "epoch": 0.38120237874001117,
      "grad_norm": 0.29746225476264954,
      "learning_rate": 2.314617200490993e-06,
      "loss": 0.0761,
      "mae_dtheta": 0.009596888907253742,
      "mae_dx": 0.0011132709914818406,
      "mae_dy": 0.0023161228746175766,
      "pose_mae_dtheta": 0.06087581813335419,
      "pose_mae_dx": 0.018826104700565338,
      "pose_mae_dy": 0.030502019450068474,
      "pose_rmse_dtheta": 0.11210808157920837,
      "pose_rmse_dx": 0.04596253111958504,
      "pose_rmse_dy": 0.06905413419008255,
      "pose_rmse_mean": 0.07570825517177582,
      "rmse_dtheta": 0.017893534153699875,
      "rmse_dx": 0.003142987610772252,
      "rmse_dy": 0.004986904561519623,
      "rmse_mean": 0.00867447629570961,
      "rotation_flip": 0.007446016184985638,
      "sparse_tokens": 31964.0,
      "step": 8205,
      "turn_loss": 0.07490625232458115,
      "turns": 193.0,
      "turns_per_sample": 193.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.38124883850585395,
      "grad_norm": 0.3987479507923126,
      "learning_rate": 2.3135019582658803e-06,
      "loss": 0.098,
      "mae_dtheta": 0.014059008099138737,
      "mae_dx": 0.0032010271679610014,
      "mae_dy": 0.005650902166962624,
      "pose_mae_dtheta": 0.09028393775224686,
      "pose_mae_dx": 0.03735589236021042,
      "pose_mae_dy": 0.04493417590856552,
      "pose_rmse_dtheta": 0.1872386932373047,
      "pose_rmse_dx": 0.09168893843889236,
      "pose_rmse_dy": 0.10755740851163864,
      "pose_rmse_mean": 0.12882834672927856,
      "rmse_dtheta": 0.02522992715239525,
      "rmse_dx": 0.007525219582021236,
      "rmse_dy": 0.011902185156941414,
      "rmse_mean": 0.014885778538882732,
      "rotation_flip": 0.006990679074078798,
      "sparse_tokens": 32073.0,
      "step": 8206,
      "turn_loss": 0.1362125277519226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3812952982716967,
      "grad_norm": 0.4940012991428375,
      "learning_rate": 2.3123869039090198e-06,
      "loss": 0.0832,
      "mae_dtheta": 0.008227100595831871,
      "mae_dx": 0.002092555398121476,
      "mae_dy": 0.0007372397813014686,
      "pose_mae_dtheta": 0.06210184842348099,
      "pose_mae_dx": 0.018733888864517212,
      "pose_mae_dy": 0.010379374958574772,
      "pose_rmse_dtheta": 0.23282314836978912,
      "pose_rmse_dx": 0.0520111583173275,
      "pose_rmse_dy": 0.031674325466156006,
      "pose_rmse_mean": 0.10550287365913391,
      "rmse_dtheta": 0.027610192075371742,
      "rmse_dx": 0.006721357814967632,
      "rmse_dy": 0.0021901142317801714,
      "rmse_mean": 0.012173887342214584,
      "rotation_flip": 0.0019157087663188577,
      "sparse_tokens": 32153.0,
      "step": 8207,
      "turn_loss": 0.05394420772790909,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.3813417580375395,
      "grad_norm": 0.5121995806694031,
      "learning_rate": 2.3112720374983826e-06,
      "loss": 0.1005,
      "mae_dtheta": 0.027471238747239113,
      "mae_dx": 0.009487285278737545,
      "mae_dy": 0.0047849793918430805,
      "pose_mae_dtheta": 0.20190921425819397,
      "pose_mae_dx": 0.08325184136629105,
      "pose_mae_dy": 0.053329017013311386,
      "pose_rmse_dtheta": 0.3603074252605438,
      "pose_rmse_dx": 0.1892440766096115,
      "pose_rmse_dy": 0.1075860857963562,
      "pose_rmse_mean": 0.21904586255550385,
      "rmse_dtheta": 0.04351399838924408,
      "rmse_dx": 0.021187156438827515,
      "rmse_dy": 0.00887640193104744,
      "rmse_mean": 0.024525851011276245,
      "rotation_flip": 0.01773323118686676,
      "sparse_tokens": 23195.0,
      "step": 8208,
      "turn_loss": 0.2271285206079483,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3813882178033823,
      "grad_norm": 0.6059248447418213,
      "learning_rate": 2.310157359111938e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.009923960082232952,
      "mae_dx": 0.0013258506078273058,
      "mae_dy": 0.0023754918947815895,
      "pose_mae_dtheta": 0.062064364552497864,
      "pose_mae_dx": 0.019585028290748596,
      "pose_mae_dy": 0.025397315621376038,
      "pose_rmse_dtheta": 0.16069406270980835,
      "pose_rmse_dx": 0.04640531167387962,
      "pose_rmse_dy": 0.05788431689143181,
      "pose_rmse_mean": 0.08832789957523346,
      "rmse_dtheta": 0.021483702585101128,
      "rmse_dx": 0.0035001621581614017,
      "rmse_dy": 0.004860409069806337,
      "rmse_mean": 0.009948091581463814,
      "rotation_flip": 0.009939651936292648,
      "sparse_tokens": 32105.0,
      "step": 8209,
      "turn_loss": 0.07472093403339386,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.38143467756922506,
      "grad_norm": 0.5546061396598816,
      "learning_rate": 2.3090428688276307e-06,
      "loss": 0.1649,
      "mae_dtheta": 0.0065879556350409985,
      "mae_dx": 0.0015069539658725262,
      "mae_dy": 0.00075922766700387,
      "pose_mae_dtheta": 0.04950953647494316,
      "pose_mae_dx": 0.012588975951075554,
      "pose_mae_dy": 0.012654727324843407,
      "pose_rmse_dtheta": 0.20657682418823242,
      "pose_rmse_dx": 0.032753486186265945,
      "pose_rmse_dy": 0.03754293546080589,
      "pose_rmse_mean": 0.09229107946157455,
      "rmse_dtheta": 0.022678470239043236,
      "rmse_dx": 0.0050840359181165695,
      "rmse_dy": 0.00187141471542418,
      "rmse_mean": 0.009877974167466164,
      "rotation_flip": 0.0015360983088612556,
      "sparse_tokens": 32105.0,
      "step": 8210,
      "turn_loss": 0.05805043503642082,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.38148113733506783,
      "grad_norm": 0.4404836595058441,
      "learning_rate": 2.3079285667234017e-06,
      "loss": 0.0883,
      "mae_dtheta": 0.007089719176292419,
      "mae_dx": 0.0010256700916215777,
      "mae_dy": 0.002020302228629589,
      "pose_mae_dtheta": 0.047323476523160934,
      "pose_mae_dx": 0.017226411029696465,
      "pose_mae_dy": 0.02176281437277794,
      "pose_rmse_dtheta": 0.10434620082378387,
      "pose_rmse_dx": 0.04916851967573166,
      "pose_rmse_dy": 0.06218767166137695,
      "pose_rmse_mean": 0.07190079987049103,
      "rmse_dtheta": 0.014938615262508392,
      "rmse_dx": 0.002567010698840022,
      "rmse_dy": 0.004620131570845842,
      "rmse_mean": 0.007375252433121204,
      "rotation_flip": 0.00408719340339303,
      "sparse_tokens": 32073.0,
      "step": 8211,
      "turn_loss": 0.06051943078637123,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.3815275971009106,
      "grad_norm": 0.47920772433280945,
      "learning_rate": 2.3068144528771712e-06,
      "loss": 0.0818,
      "mae_dtheta": 0.03379465267062187,
      "mae_dx": 0.010412878356873989,
      "mae_dy": 0.0039148819632828236,
      "pose_mae_dtheta": 0.25838735699653625,
      "pose_mae_dx": 0.09984958916902542,
      "pose_mae_dy": 0.06564638763666153,
      "pose_rmse_dtheta": 0.4416549503803253,
      "pose_rmse_dx": 0.2195861041545868,
      "pose_rmse_dy": 0.15634670853614807,
      "pose_rmse_mean": 0.2725292444229126,
      "rmse_dtheta": 0.05447164922952652,
      "rmse_dx": 0.022317850962281227,
      "rmse_dy": 0.007617987226694822,
      "rmse_mean": 0.02813582867383957,
      "rotation_flip": 0.022727273404598236,
      "sparse_tokens": 6028.0,
      "step": 8212,
      "turn_loss": 0.19661231338977814,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 35038.0,
      "epoch": 0.3815740568667534,
      "grad_norm": 0.642290472984314,
      "learning_rate": 2.305700527366853e-06,
      "loss": 0.182,
      "mae_dtheta": 0.029501941055059433,
      "mae_dx": 0.010557711124420166,
      "mae_dy": 0.003925628028810024,
      "pose_mae_dtheta": 0.21739965677261353,
      "pose_mae_dx": 0.08674905449151993,
      "pose_mae_dy": 0.04589231684803963,
      "pose_rmse_dtheta": 0.40056881308555603,
      "pose_rmse_dx": 0.19080743193626404,
      "pose_rmse_dy": 0.11925048381090164,
      "pose_rmse_mean": 0.23687557876110077,
      "rmse_dtheta": 0.04738513007760048,
      "rmse_dx": 0.02213405631482601,
      "rmse_dy": 0.008383283391594887,
      "rmse_mean": 0.025967489928007126,
      "rotation_flip": 0.010162601247429848,
      "sparse_tokens": 27128.0,
      "step": 8213,
      "turn_loss": 0.2223217636346817,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 31046.0,
      "epoch": 0.38162051663259616,
      "grad_norm": 0.38973796367645264,
      "learning_rate": 2.3045867902703417e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.035962920635938644,
      "mae_dx": 0.01106482557952404,
      "mae_dy": 0.00448428513482213,
      "pose_mae_dtheta": 0.29628852009773254,
      "pose_mae_dx": 0.08540628105401993,
      "pose_mae_dy": 0.04753071814775467,
      "pose_rmse_dtheta": 0.5055859684944153,
      "pose_rmse_dx": 0.18600231409072876,
      "pose_rmse_dy": 0.12669959664344788,
      "pose_rmse_mean": 0.27276262640953064,
      "rmse_dtheta": 0.05483178794384003,
      "rmse_dx": 0.021950647234916687,
      "rmse_dy": 0.01060336921364069,
      "rmse_mean": 0.029128601774573326,
      "rotation_flip": 0.008577555418014526,
      "sparse_tokens": 24702.0,
      "step": 8214,
      "turn_loss": 0.30210474133491516,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.38166697639843894,
      "grad_norm": 0.5617057085037231,
      "learning_rate": 2.3034732416655247e-06,
      "loss": 0.1598,
      "mae_dtheta": 0.004620587918907404,
      "mae_dx": 0.0010863577481359243,
      "mae_dy": 0.0014565861783921719,
      "pose_mae_dtheta": 0.033894024789333344,
      "pose_mae_dx": 0.013982634991407394,
      "pose_mae_dy": 0.015267839655280113,
      "pose_rmse_dtheta": 0.10559971630573273,
      "pose_rmse_dx": 0.04150167107582092,
      "pose_rmse_dy": 0.04245121031999588,
      "pose_rmse_mean": 0.06318420171737671,
      "rmse_dtheta": 0.014534891583025455,
      "rmse_dx": 0.0031413123942911625,
      "rmse_dy": 0.004092281684279442,
      "rmse_mean": 0.007256162352859974,
      "rotation_flip": 0.002352941082790494,
      "sparse_tokens": 32073.0,
      "step": 8215,
      "turn_loss": 0.045570600777864456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3817134361642817,
      "grad_norm": 0.749544620513916,
      "learning_rate": 2.3023598816302694e-06,
      "loss": 0.1618,
      "mae_dtheta": 0.008065283298492432,
      "mae_dx": 0.0013180968817323446,
      "mae_dy": 0.0014890715247020125,
      "pose_mae_dtheta": 0.05230811610817909,
      "pose_mae_dx": 0.014640290290117264,
      "pose_mae_dy": 0.016478680074214935,
      "pose_rmse_dtheta": 0.1306401789188385,
      "pose_rmse_dx": 0.036774344742298126,
      "pose_rmse_dy": 0.0392686165869236,
      "pose_rmse_mean": 0.06889437884092331,
      "rmse_dtheta": 0.01861611008644104,
      "rmse_dx": 0.0040223547257483006,
      "rmse_dy": 0.003277350217103958,
      "rmse_mean": 0.00863860547542572,
      "rotation_flip": 0.0027409775648266077,
      "sparse_tokens": 32121.0,
      "step": 8216,
      "turn_loss": 0.07516854256391525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.3817598959301245,
      "grad_norm": 1.0143059492111206,
      "learning_rate": 2.3012467102424373e-06,
      "loss": 0.2805,
      "mae_dtheta": 0.028066087514162064,
      "mae_dx": 0.012806744314730167,
      "mae_dy": 0.003947333432734013,
      "pose_mae_dtheta": 0.21937872469425201,
      "pose_mae_dx": 0.09824469685554504,
      "pose_mae_dy": 0.048885125666856766,
      "pose_rmse_dtheta": 0.4143393337726593,
      "pose_rmse_dx": 0.24079030752182007,
      "pose_rmse_dy": 0.1283750683069229,
      "pose_rmse_mean": 0.2611682415008545,
      "rmse_dtheta": 0.04630115255713463,
      "rmse_dx": 0.026640094816684723,
      "rmse_dy": 0.008883357048034668,
      "rmse_mean": 0.02727486751973629,
      "rotation_flip": 0.011565836146473885,
      "sparse_tokens": 21646.0,
      "step": 8217,
      "turn_loss": 0.2350602149963379,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 8465.0,
      "epoch": 0.38180635569596727,
      "grad_norm": 0.8125606179237366,
      "learning_rate": 2.3001337275798693e-06,
      "loss": 0.2537,
      "mae_dtheta": 0.03163796663284302,
      "mae_dx": 0.011568071320652962,
      "mae_dy": 0.0035509567242115736,
      "pose_mae_dtheta": 0.231950581073761,
      "pose_mae_dx": 0.07803254574537277,
      "pose_mae_dy": 0.03346097469329834,
      "pose_rmse_dtheta": 0.45924580097198486,
      "pose_rmse_dx": 0.16879989206790924,
      "pose_rmse_dy": 0.09997794777154922,
      "pose_rmse_mean": 0.2426745593547821,
      "rmse_dtheta": 0.05030568689107895,
      "rmse_dx": 0.0231213066726923,
      "rmse_dy": 0.00732733029872179,
      "rmse_mean": 0.026918109506368637,
      "rotation_flip": 0.00913241971284151,
      "sparse_tokens": 6549.0,
      "step": 8218,
      "turn_loss": 0.22584925591945648,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.38185281546181005,
      "grad_norm": 0.42928746342658997,
      "learning_rate": 2.2990209337204006e-06,
      "loss": 0.1094,
      "mae_dtheta": 0.03293796628713608,
      "mae_dx": 0.012819362804293633,
      "mae_dy": 0.004532161168754101,
      "pose_mae_dtheta": 0.2604961693286896,
      "pose_mae_dx": 0.1052408367395401,
      "pose_mae_dy": 0.0463392436504364,
      "pose_rmse_dtheta": 0.4576130211353302,
      "pose_rmse_dx": 0.22728537023067474,
      "pose_rmse_dy": 0.11820648610591888,
      "pose_rmse_mean": 0.2677016258239746,
      "rmse_dtheta": 0.05079702287912369,
      "rmse_dx": 0.025083769112825394,
      "rmse_dy": 0.01035257801413536,
      "rmse_mean": 0.02874445915222168,
      "rotation_flip": 0.009078212082386017,
      "sparse_tokens": 23455.0,
      "step": 8219,
      "turn_loss": 0.2882913649082184,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.3818992752276529,
      "grad_norm": 0.7686054706573486,
      "learning_rate": 2.2979083287418456e-06,
      "loss": 0.1692,
      "mae_dtheta": 0.014023816213011742,
      "mae_dx": 0.005282791797071695,
      "mae_dy": 0.007135938387364149,
      "pose_mae_dtheta": 0.09660200029611588,
      "pose_mae_dx": 0.059772368520498276,
      "pose_mae_dy": 0.060751769691705704,
      "pose_rmse_dtheta": 0.24125666916370392,
      "pose_rmse_dx": 0.17238284647464752,
      "pose_rmse_dy": 0.16858145594596863,
      "pose_rmse_mean": 0.1940736621618271,
      "rmse_dtheta": 0.028505731374025345,
      "rmse_dx": 0.01571926660835743,
      "rmse_dy": 0.017718076705932617,
      "rmse_mean": 0.020647693425416946,
      "rotation_flip": 0.004261914175003767,
      "sparse_tokens": 32025.0,
      "step": 8220,
      "turn_loss": 0.20044496655464172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.38194573499349566,
      "grad_norm": 0.47779059410095215,
      "learning_rate": 2.296795912722014e-06,
      "loss": 0.0631,
      "mae_dtheta": 0.021129652857780457,
      "mae_dx": 0.007334358990192413,
      "mae_dy": 0.0047577437944710255,
      "pose_mae_dtheta": 0.170891672372818,
      "pose_mae_dx": 0.055364940315485,
      "pose_mae_dy": 0.05999987944960594,
      "pose_rmse_dtheta": 0.27216222882270813,
      "pose_rmse_dx": 0.12541453540325165,
      "pose_rmse_dy": 0.14055010676383972,
      "pose_rmse_mean": 0.17937561869621277,
      "rmse_dtheta": 0.03195110335946083,
      "rmse_dx": 0.01792106404900551,
      "rmse_dy": 0.008586830459535122,
      "rmse_mean": 0.019486334174871445,
      "rotation_flip": 0.00566572230309248,
      "sparse_tokens": 7139.0,
      "step": 8221,
      "turn_loss": 0.19048544764518738,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.38199219475933843,
      "grad_norm": 0.3845156729221344,
      "learning_rate": 2.2956836857386927e-06,
      "loss": 0.0879,
      "mae_dtheta": 0.005497847218066454,
      "mae_dx": 0.001140096108429134,
      "mae_dy": 0.0009718313231132925,
      "pose_mae_dtheta": 0.037728868424892426,
      "pose_mae_dx": 0.010390609502792358,
      "pose_mae_dy": 0.012743084691464901,
      "pose_rmse_dtheta": 0.13251711428165436,
      "pose_rmse_dx": 0.022642651572823524,
      "pose_rmse_dy": 0.03218337893486023,
      "pose_rmse_mean": 0.062447719275951385,
      "rmse_dtheta": 0.01630508527159691,
      "rmse_dx": 0.0032110323663800955,
      "rmse_dy": 0.001963301794603467,
      "rmse_mean": 0.007159806787967682,
      "rotation_flip": 0.0029013538733124733,
      "sparse_tokens": 32153.0,
      "step": 8222,
      "turn_loss": 0.047589465975761414,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3820386545251812,
      "grad_norm": 0.5907971858978271,
      "learning_rate": 2.2945716478696633e-06,
      "loss": 0.1769,
      "mae_dtheta": 0.01179526001214981,
      "mae_dx": 0.0022354107350111008,
      "mae_dy": 0.0035442677326500416,
      "pose_mae_dtheta": 0.073910653591156,
      "pose_mae_dx": 0.029158055782318115,
      "pose_mae_dy": 0.03211615979671478,
      "pose_rmse_dtheta": 0.15388473868370056,
      "pose_rmse_dx": 0.0646829754114151,
      "pose_rmse_dy": 0.06900619715452194,
      "pose_rmse_mean": 0.09585797041654587,
      "rmse_dtheta": 0.022556815296411514,
      "rmse_dx": 0.005297400522977114,
      "rmse_dy": 0.006930151022970676,
      "rmse_mean": 0.01159478910267353,
      "rotation_flip": 0.011542160995304585,
      "sparse_tokens": 32153.0,
      "step": 8223,
      "turn_loss": 0.11015642434358597,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.382085114291024,
      "grad_norm": 0.40959054231643677,
      "learning_rate": 2.293459799192692e-06,
      "loss": 0.1331,
      "mae_dtheta": 0.010555362328886986,
      "mae_dx": 0.0016395308775827289,
      "mae_dy": 0.0032027103006839752,
      "pose_mae_dtheta": 0.06008823588490486,
      "pose_mae_dx": 0.023603131994605064,
      "pose_mae_dy": 0.03150608763098717,
      "pose_rmse_dtheta": 0.11852695792913437,
      "pose_rmse_dx": 0.059126224368810654,
      "pose_rmse_dy": 0.07030938565731049,
      "pose_rmse_mean": 0.0826541930437088,
      "rmse_dtheta": 0.02017916366457939,
      "rmse_dx": 0.0047504715621471405,
      "rmse_dy": 0.006986438296735287,
      "rmse_mean": 0.010638691484928131,
      "rotation_flip": 0.006211180239915848,
      "sparse_tokens": 32073.0,
      "step": 8224,
      "turn_loss": 0.09741760045289993,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.38213157405686676,
      "grad_norm": 0.3750366270542145,
      "learning_rate": 2.292348139785528e-06,
      "loss": 0.0777,
      "mae_dtheta": 0.008037389256060123,
      "mae_dx": 0.0014325870433822274,
      "mae_dy": 0.0020212638191878796,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3750365972518921,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.62876892089844,
      "model/head/act_norm_mean": 113.39188762626263,
      "model/head/act_norm_min": 64.01634979248047,
      "model/head/act_over_embed": 77.92396676834528,
      "model/head/grad_frac": 0.10020653158426285,
      "model/head/grad_norm": 0.03758111596107483,
      "model/head/grad_zero_frac": 0.00020305393263697624,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.703973327020202,
      "model/head/update_ratio": 0.0006402333383448422,
      "model/head/weight_delta": 9.727863311767578,
      "model/head/weight_delta_rel": 0.1706555336713791,
      "model/head/weight_norm": 58.699092864990234,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42233777046203613,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222568088107639,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4221540093421936,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901788322452852,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08561933785676956,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03211038559675217,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5334461805555556,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010369517840445042,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1033668518066406,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10139666497707367,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96613311767578,
      "model/modality_embedder/grad_frac": 0.08561933785676956,
      "model/modality_embedder/grad_norm": 0.03211038559675217,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5334461805555556,
      "model/modality_embedder/update_ratio": 0.0010369517840445042,
      "model/modality_embedder/weight_delta": 3.1033668518066406,
      "model/modality_embedder/weight_delta_rel": 0.10139666497707367,
      "model/modality_embedder/weight_norm": 30.96613311767578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.23795318603516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.949712902837902,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.125082015991211,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.45846692757506,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07141806930303574,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.026784388348460197,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009588925167918205,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6147572994232178,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09528333693742752,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.932628631591797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.18559265136719,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.924520502645503,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.401477813720703,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.128363836455378,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0722288191318512,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.027088450267910957,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009113182313740253,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3154489994049072,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1148497462272644,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.724468231201172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.96489715576172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.76287177328844,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.799964904785156,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.391696040556962,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07780536264181137,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.029179858043789864,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009506893111392856,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.5854854583740234,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12039388716220856,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.693368911743164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.43315887451172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.491349506974508,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.718497276306152,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.57952212140953,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09897583723068237,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.037119559943675995,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012407314497977495,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0734987258911133,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10503759980201721,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.917482376098633,
      "model/normalizer/grad_frac": 0.35394158959388733,
      "model/normalizer/grad_norm": 0.1327410489320755,
      "model/normalizer/grad_zero_frac": 0.00017962424317374825,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001688682590611279,
      "model/normalizer/weight_delta": 6.482361793518066,
      "model/normalizer/weight_delta_rel": 0.0834890678524971,
      "model/normalizer/weight_norm": 78.60627746582031,
      "pose_mae_dtheta": 0.049060557037591934,
      "pose_mae_dx": 0.019126009196043015,
      "pose_mae_dy": 0.022423509508371353,
      "pose_rmse_dtheta": 0.13163505494594574,
      "pose_rmse_dx": 0.04532106593251228,
      "pose_rmse_dy": 0.051048360764980316,
      "pose_rmse_mean": 0.07600149512290955,
      "rmse_dtheta": 0.01948847807943821,
      "rmse_dx": 0.003998456988483667,
      "rmse_dy": 0.004391157533973455,
      "rmse_mean": 0.00929269753396511,
      "rotation_flip": 0.0043917433358728886,
      "sparse_tokens": 32121.0,
      "step": 8225,
      "turn_loss": 0.0732436552643776,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15543.0,
      "epoch": 0.38217803382270954,
      "grad_norm": 0.41222459077835083,
      "learning_rate": 2.2912366697259137e-06,
      "loss": 0.0686,
      "mae_dtheta": 0.03347592055797577,
      "mae_dx": 0.011736794374883175,
      "mae_dy": 0.004906550981104374,
      "pose_mae_dtheta": 0.3130662739276886,
      "pose_mae_dx": 0.0984349325299263,
      "pose_mae_dy": 0.07489808648824692,
      "pose_rmse_dtheta": 0.5591247081756592,
      "pose_rmse_dx": 0.23408611118793488,
      "pose_rmse_dy": 0.1606236696243286,
      "pose_rmse_mean": 0.31794482469558716,
      "rmse_dtheta": 0.05294997617602348,
      "rmse_dx": 0.025812694802880287,
      "rmse_dy": 0.009556254372000694,
      "rmse_mean": 0.029439643025398254,
      "rotation_flip": 0.010279001668095589,
      "sparse_tokens": 11978.0,
      "step": 8226,
      "turn_loss": 0.26487770676612854,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3822244935885523,
      "grad_norm": 0.3686850965023041,
      "learning_rate": 2.2901253890915714e-06,
      "loss": 0.0691,
      "mae_dtheta": 0.007012839894741774,
      "mae_dx": 0.001018880750052631,
      "mae_dy": 0.0011404957622289658,
      "pose_mae_dtheta": 0.046223510056734085,
      "pose_mae_dx": 0.012706059962511063,
      "pose_mae_dy": 0.018040426075458527,
      "pose_rmse_dtheta": 0.12212017923593521,
      "pose_rmse_dx": 0.03655356913805008,
      "pose_rmse_dy": 0.04360344633460045,
      "pose_rmse_mean": 0.06742573529481888,
      "rmse_dtheta": 0.018335403874516487,
      "rmse_dx": 0.003970959223806858,
      "rmse_dy": 0.002294326899573207,
      "rmse_mean": 0.008200230076909065,
      "rotation_flip": 0.000507872027810663,
      "sparse_tokens": 32041.0,
      "step": 8227,
      "turn_loss": 0.04670298099517822,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3822709533543951,
      "grad_norm": 0.5121293067932129,
      "learning_rate": 2.289014297960215e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.008098057471215725,
      "mae_dx": 0.0013074958696961403,
      "mae_dy": 0.001348945777863264,
      "pose_mae_dtheta": 0.05289129167795181,
      "pose_mae_dx": 0.014175164513289928,
      "pose_mae_dy": 0.014425680041313171,
      "pose_rmse_dtheta": 0.16927564144134521,
      "pose_rmse_dx": 0.032706040889024734,
      "pose_rmse_dy": 0.03526005893945694,
      "pose_rmse_mean": 0.07908058166503906,
      "rmse_dtheta": 0.021439028903841972,
      "rmse_dx": 0.003611465450376272,
      "rmse_dy": 0.0034851336386054754,
      "rmse_mean": 0.009511876851320267,
      "rotation_flip": 0.0047961631789803505,
      "sparse_tokens": 32137.0,
      "step": 8228,
      "turn_loss": 0.05602443963289261,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.38231741312023787,
      "grad_norm": 0.3089312016963959,
      "learning_rate": 2.2879033964095453e-06,
      "loss": 0.1005,
      "mae_dtheta": 0.009993505664169788,
      "mae_dx": 0.002451393287628889,
      "mae_dy": 0.0022185449488461018,
      "pose_mae_dtheta": 0.07164241373538971,
      "pose_mae_dx": 0.018661731854081154,
      "pose_mae_dy": 0.023491190746426582,
      "pose_rmse_dtheta": 0.22510138154029846,
      "pose_rmse_dx": 0.055905792862176895,
      "pose_rmse_dy": 0.10065637528896332,
      "pose_rmse_mean": 0.12722119688987732,
      "rmse_dtheta": 0.027609936892986298,
      "rmse_dx": 0.008571824058890343,
      "rmse_dy": 0.008169037289917469,
      "rmse_mean": 0.014783600345253944,
      "rotation_flip": 0.0014111006166785955,
      "sparse_tokens": 32153.0,
      "step": 8229,
      "turn_loss": 0.09539516270160675,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.38236387288608065,
      "grad_norm": 0.41868817806243896,
      "learning_rate": 2.286792684517245e-06,
      "loss": 0.0919,
      "mae_dtheta": 0.011188598349690437,
      "mae_dx": 0.001526996144093573,
      "mae_dy": 0.0026527848094701767,
      "pose_mae_dtheta": 0.07057014107704163,
      "pose_mae_dx": 0.024475425481796265,
      "pose_mae_dy": 0.03222872316837311,
      "pose_rmse_dtheta": 0.15135648846626282,
      "pose_rmse_dx": 0.06579174846410751,
      "pose_rmse_dy": 0.06889036297798157,
      "pose_rmse_mean": 0.09534620493650436,
      "rmse_dtheta": 0.021913614124059677,
      "rmse_dx": 0.004123691935092211,
      "rmse_dy": 0.00529918447136879,
      "rmse_mean": 0.010445496998727322,
      "rotation_flip": 0.00470746448263526,
      "sparse_tokens": 32105.0,
      "step": 8230,
      "turn_loss": 0.08792249858379364,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3824103326519234,
      "grad_norm": 0.3979058861732483,
      "learning_rate": 2.285682162360991e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.010979881510138512,
      "mae_dx": 0.001373549923300743,
      "mae_dy": 0.002444045152515173,
      "pose_mae_dtheta": 0.07624179869890213,
      "pose_mae_dx": 0.022695325314998627,
      "pose_mae_dy": 0.03223797678947449,
      "pose_rmse_dtheta": 0.19010886549949646,
      "pose_rmse_dx": 0.0738653764128685,
      "pose_rmse_dy": 0.08543743938207626,
      "pose_rmse_mean": 0.116470567882061,
      "rmse_dtheta": 0.022573893889784813,
      "rmse_dx": 0.0043288106098771095,
      "rmse_dy": 0.006000087596476078,
      "rmse_mean": 0.010967597365379333,
      "rotation_flip": 0.0030075188260525465,
      "sparse_tokens": 32057.0,
      "step": 8231,
      "turn_loss": 0.06882430613040924,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.3824567924177662,
      "grad_norm": 0.38890862464904785,
      "learning_rate": 2.2845718300184376e-06,
      "loss": 0.068,
      "mae_dtheta": 0.019319340586662292,
      "mae_dx": 0.006478883326053619,
      "mae_dy": 0.003655579872429371,
      "pose_mae_dtheta": 0.13576248288154602,
      "pose_mae_dx": 0.06520593911409378,
      "pose_mae_dy": 0.04363976791501045,
      "pose_rmse_dtheta": 0.24037837982177734,
      "pose_rmse_dx": 0.16916796565055847,
      "pose_rmse_dy": 0.09190872311592102,
      "pose_rmse_mean": 0.16715168952941895,
      "rmse_dtheta": 0.032209549099206924,
      "rmse_dx": 0.016098177060484886,
      "rmse_dy": 0.007928404957056046,
      "rmse_mean": 0.01874537765979767,
      "rotation_flip": 0.014652014710009098,
      "sparse_tokens": 9751.0,
      "step": 8232,
      "turn_loss": 0.19430479407310486,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.382503252183609,
      "grad_norm": 0.39540594816207886,
      "learning_rate": 2.2834616875672362e-06,
      "loss": 0.0898,
      "mae_dtheta": 0.010760952718555927,
      "mae_dx": 0.002133660251274705,
      "mae_dy": 0.0020260142628103495,
      "pose_mae_dtheta": 0.06597529351711273,
      "pose_mae_dx": 0.021937187761068344,
      "pose_mae_dy": 0.02435510791838169,
      "pose_rmse_dtheta": 0.19729755818843842,
      "pose_rmse_dx": 0.057457007467746735,
      "pose_rmse_dy": 0.060252293944358826,
      "pose_rmse_mean": 0.10500228404998779,
      "rmse_dtheta": 0.02545054815709591,
      "rmse_dx": 0.006982794031500816,
      "rmse_dy": 0.00426531070843339,
      "rmse_mean": 0.012232884764671326,
      "rotation_flip": 0.004361617844551802,
      "sparse_tokens": 32153.0,
      "step": 8233,
      "turn_loss": 0.10917140543460846,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.38254971194945175,
      "grad_norm": 0.35278135538101196,
      "learning_rate": 2.2823517350850145e-06,
      "loss": 0.0765,
      "mae_dtheta": 0.005982162896543741,
      "mae_dx": 0.0013441025512292981,
      "mae_dy": 0.00024010181368794292,
      "pose_mae_dtheta": 0.046374835073947906,
      "pose_mae_dx": 0.010988821275532246,
      "pose_mae_dy": 0.003599800169467926,
      "pose_rmse_dtheta": 0.2130756378173828,
      "pose_rmse_dx": 0.02480047382414341,
      "pose_rmse_dy": 0.013452115468680859,
      "pose_rmse_mean": 0.0837760791182518,
      "rmse_dtheta": 0.023689012974500656,
      "rmse_dx": 0.003545100102201104,
      "rmse_dy": 0.0005930972984060645,
      "rmse_mean": 0.009275737218558788,
      "rotation_flip": 0.0022246940061450005,
      "sparse_tokens": 32249.0,
      "step": 8234,
      "turn_loss": 0.04397472366690636,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.38259617171529453,
      "grad_norm": 0.6205623149871826,
      "learning_rate": 2.2812419726493952e-06,
      "loss": 0.1449,
      "mae_dtheta": 0.009469889104366302,
      "mae_dx": 0.0013710042694583535,
      "mae_dy": 0.0025796834379434586,
      "pose_mae_dtheta": 0.06473584473133087,
      "pose_mae_dx": 0.0208482276648283,
      "pose_mae_dy": 0.027924638241529465,
      "pose_rmse_dtheta": 0.17024792730808258,
      "pose_rmse_dx": 0.05433177947998047,
      "pose_rmse_dy": 0.06327706575393677,
      "pose_rmse_mean": 0.09595225751399994,
      "rmse_dtheta": 0.021479085087776184,
      "rmse_dx": 0.0038285532500594854,
      "rmse_dy": 0.005287298932671547,
      "rmse_mean": 0.010198312811553478,
      "rotation_flip": 0.002770083025097847,
      "sparse_tokens": 32089.0,
      "step": 8235,
      "turn_loss": 0.07793692499399185,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.3826426314811373,
      "grad_norm": 0.4837917685508728,
      "learning_rate": 2.2801324003379854e-06,
      "loss": 0.0953,
      "mae_dtheta": 0.030929425731301308,
      "mae_dx": 0.00450507877394557,
      "mae_dy": 0.006540435366332531,
      "pose_mae_dtheta": 0.26828932762145996,
      "pose_mae_dx": 0.039064034819602966,
      "pose_mae_dy": 0.07483363151550293,
      "pose_rmse_dtheta": 0.42639440298080444,
      "pose_rmse_dx": 0.0741511806845665,
      "pose_rmse_dy": 0.15760201215744019,
      "pose_rmse_mean": 0.21938252449035645,
      "rmse_dtheta": 0.04707309603691101,
      "rmse_dx": 0.010226188227534294,
      "rmse_dy": 0.012035873718559742,
      "rmse_mean": 0.023111721500754356,
      "rotation_flip": 0.007633587811142206,
      "sparse_tokens": 3928.0,
      "step": 8236,
      "turn_loss": 0.2095349282026291,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.38268909124698014,
      "grad_norm": 0.3265721797943115,
      "learning_rate": 2.2790230182283745e-06,
      "loss": 0.0859,
      "mae_dtheta": 0.008167952299118042,
      "mae_dx": 0.0013614887138828635,
      "mae_dy": 0.0020509008318185806,
      "pose_mae_dtheta": 0.05171452835202217,
      "pose_mae_dx": 0.02018001303076744,
      "pose_mae_dy": 0.0248509980738163,
      "pose_rmse_dtheta": 0.1126013845205307,
      "pose_rmse_dx": 0.06102682277560234,
      "pose_rmse_dy": 0.061079420149326324,
      "pose_rmse_mean": 0.07823587954044342,
      "rmse_dtheta": 0.0167158842086792,
      "rmse_dx": 0.004853467922657728,
      "rmse_dy": 0.004508547950536013,
      "rmse_mean": 0.008692633360624313,
      "rotation_flip": 0.0016549441497772932,
      "sparse_tokens": 32089.0,
      "step": 8237,
      "turn_loss": 0.06977512687444687,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.3827355510128229,
      "grad_norm": 0.47621574997901917,
      "learning_rate": 2.277913826398147e-06,
      "loss": 0.0864,
      "mae_dtheta": 0.03330003470182419,
      "mae_dx": 0.014231521636247635,
      "mae_dy": 0.003664810676127672,
      "pose_mae_dtheta": 0.2507525682449341,
      "pose_mae_dx": 0.11709684878587723,
      "pose_mae_dy": 0.04711270332336426,
      "pose_rmse_dtheta": 0.4603419601917267,
      "pose_rmse_dx": 0.23407645523548126,
      "pose_rmse_dy": 0.09622521698474884,
      "pose_rmse_mean": 0.2635478973388672,
      "rmse_dtheta": 0.05023716762661934,
      "rmse_dx": 0.025975259020924568,
      "rmse_dy": 0.006749246269464493,
      "rmse_mean": 0.027653893455863,
      "rotation_flip": 0.017574692144989967,
      "sparse_tokens": 9974.0,
      "step": 8238,
      "turn_loss": 0.2699964642524719,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.3827820107786657,
      "grad_norm": 0.46288931369781494,
      "learning_rate": 2.2768048249248648e-06,
      "loss": 0.0909,
      "mae_dtheta": 0.026915142312645912,
      "mae_dx": 0.0073943366296589375,
      "mae_dy": 0.00670413626357913,
      "pose_mae_dtheta": 0.2002328783273697,
      "pose_mae_dx": 0.061403676867485046,
      "pose_mae_dy": 0.08348233997821808,
      "pose_rmse_dtheta": 0.347944974899292,
      "pose_rmse_dx": 0.15475083887577057,
      "pose_rmse_dy": 0.21678243577480316,
      "pose_rmse_mean": 0.23982608318328857,
      "rmse_dtheta": 0.04336674511432648,
      "rmse_dx": 0.01772930845618248,
      "rmse_dy": 0.01429547369480133,
      "rmse_mean": 0.025130510330200195,
      "rotation_flip": 0.012376237660646439,
      "sparse_tokens": 7350.0,
      "step": 8239,
      "turn_loss": 0.3081614673137665,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.38282847054450847,
      "grad_norm": 0.4035935401916504,
      "learning_rate": 2.275696013886084e-06,
      "loss": 0.098,
      "mae_dtheta": 0.005899543408304453,
      "mae_dx": 0.001031249645166099,
      "mae_dy": 0.001049728482030332,
      "pose_mae_dtheta": 0.04151628911495209,
      "pose_mae_dx": 0.00947440043091774,
      "pose_mae_dy": 0.013425972312688828,
      "pose_rmse_dtheta": 0.1439773440361023,
      "pose_rmse_dx": 0.020590607076883316,
      "pose_rmse_dy": 0.030317671597003937,
      "pose_rmse_mean": 0.06496187299489975,
      "rmse_dtheta": 0.016325103119015694,
      "rmse_dx": 0.002937422366812825,
      "rmse_dy": 0.0023368257097899914,
      "rmse_mean": 0.007199784275144339,
      "rotation_flip": 0.0020946795120835304,
      "sparse_tokens": 32153.0,
      "step": 8240,
      "turn_loss": 0.04392869025468826,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.38287493031035125,
      "grad_norm": 0.777851402759552,
      "learning_rate": 2.274587393359342e-06,
      "loss": 0.1396,
      "mae_dtheta": 0.01385416928678751,
      "mae_dx": 0.002515404252335429,
      "mae_dy": 0.002874101046472788,
      "pose_mae_dtheta": 0.10536780953407288,
      "pose_mae_dx": 0.021700197830796242,
      "pose_mae_dy": 0.02598244696855545,
      "pose_rmse_dtheta": 0.3090711534023285,
      "pose_rmse_dx": 0.06765348464250565,
      "pose_rmse_dy": 0.08677545189857483,
      "pose_rmse_mean": 0.15450003743171692,
      "rmse_dtheta": 0.0347968228161335,
      "rmse_dx": 0.007954197004437447,
      "rmse_dy": 0.008855177089571953,
      "rmse_mean": 0.017202068120241165,
      "rotation_flip": 0.00917431153357029,
      "sparse_tokens": 32153.0,
      "step": 8241,
      "turn_loss": 0.11843317002058029,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.382921390076194,
      "grad_norm": 0.4564652442932129,
      "learning_rate": 2.273478963422166e-06,
      "loss": 0.0933,
      "mae_dtheta": 0.013013062067329884,
      "mae_dx": 0.0021377422381192446,
      "mae_dy": 0.0038829073309898376,
      "pose_mae_dtheta": 0.08880549669265747,
      "pose_mae_dx": 0.03413103148341179,
      "pose_mae_dy": 0.036440905183553696,
      "pose_rmse_dtheta": 0.19411621987819672,
      "pose_rmse_dx": 0.08931799978017807,
      "pose_rmse_dy": 0.07927830517292023,
      "pose_rmse_mean": 0.12090416997671127,
      "rmse_dtheta": 0.023950673639774323,
      "rmse_dx": 0.0059673599898815155,
      "rmse_dy": 0.0074275764636695385,
      "rmse_mean": 0.012448537163436413,
      "rotation_flip": 0.007312614470720291,
      "sparse_tokens": 32089.0,
      "step": 8242,
      "turn_loss": 0.10827366262674332,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3829678498420368,
      "grad_norm": 0.3842278718948364,
      "learning_rate": 2.2723707241520714e-06,
      "loss": 0.092,
      "mae_dtheta": 0.00987094547599554,
      "mae_dx": 0.0015731664607301354,
      "mae_dy": 0.002647304441779852,
      "pose_mae_dtheta": 0.0630093440413475,
      "pose_mae_dx": 0.023229222744703293,
      "pose_mae_dy": 0.028984202072024345,
      "pose_rmse_dtheta": 0.14321477711200714,
      "pose_rmse_dx": 0.055616237223148346,
      "pose_rmse_dy": 0.060711443424224854,
      "pose_rmse_mean": 0.08651416003704071,
      "rmse_dtheta": 0.01958736777305603,
      "rmse_dx": 0.004236401058733463,
      "rmse_dy": 0.0056060561910271645,
      "rmse_mean": 0.009809941053390503,
      "rotation_flip": 0.0035197497345507145,
      "sparse_tokens": 32089.0,
      "step": 8243,
      "turn_loss": 0.07964401692152023,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.3830143096078796,
      "grad_norm": 0.5580204725265503,
      "learning_rate": 2.2712626756265545e-06,
      "loss": 0.1995,
      "mae_dtheta": 0.03675545006990433,
      "mae_dx": 0.01198903750628233,
      "mae_dy": 0.010293625295162201,
      "pose_mae_dtheta": 0.2736503779888153,
      "pose_mae_dx": 0.09075528383255005,
      "pose_mae_dy": 0.11604637652635574,
      "pose_rmse_dtheta": 0.484887957572937,
      "pose_rmse_dx": 0.20565156638622284,
      "pose_rmse_dy": 0.2577275037765503,
      "pose_rmse_mean": 0.31608903408050537,
      "rmse_dtheta": 0.05477790907025337,
      "rmse_dx": 0.024793747812509537,
      "rmse_dy": 0.02046043425798416,
      "rmse_mean": 0.03334403038024902,
      "rotation_flip": 0.0118443313986063,
      "sparse_tokens": 11067.0,
      "step": 8244,
      "turn_loss": 0.3102124035358429,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.38306076937372235,
      "grad_norm": 0.5463891625404358,
      "learning_rate": 2.2701548179231048e-06,
      "loss": 0.0844,
      "mae_dtheta": 0.0089096175506711,
      "mae_dx": 0.002511607250198722,
      "mae_dy": 0.001926164492033422,
      "pose_mae_dtheta": 0.06915373355150223,
      "pose_mae_dx": 0.02945546619594097,
      "pose_mae_dy": 0.02056516706943512,
      "pose_rmse_dtheta": 0.19682659208774567,
      "pose_rmse_dx": 0.10521255433559418,
      "pose_rmse_dy": 0.06219913065433502,
      "pose_rmse_mean": 0.12141275405883789,
      "rmse_dtheta": 0.023106303066015244,
      "rmse_dx": 0.008945335634052753,
      "rmse_dy": 0.0056036231108009815,
      "rmse_mean": 0.012551753781735897,
      "rotation_flip": 0.0011129660997539759,
      "sparse_tokens": 32073.0,
      "step": 8245,
      "turn_loss": 0.07448409497737885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.38310722913956513,
      "grad_norm": 0.6619054079055786,
      "learning_rate": 2.2690471511191918e-06,
      "loss": 0.1829,
      "mae_dtheta": 0.03761117532849312,
      "mae_dx": 0.012262935750186443,
      "mae_dy": 0.006114535499364138,
      "pose_mae_dtheta": 0.2953123152256012,
      "pose_mae_dx": 0.0909697413444519,
      "pose_mae_dy": 0.05805959925055504,
      "pose_rmse_dtheta": 0.49476325511932373,
      "pose_rmse_dx": 0.19733919203281403,
      "pose_rmse_dy": 0.1353340595960617,
      "pose_rmse_mean": 0.27581217885017395,
      "rmse_dtheta": 0.05583366006612778,
      "rmse_dx": 0.024311207234859467,
      "rmse_dy": 0.013586469925940037,
      "rmse_mean": 0.03124377876520157,
      "rotation_flip": 0.013250194489955902,
      "sparse_tokens": 20869.0,
      "step": 8246,
      "turn_loss": 0.3020700216293335,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3831536889054079,
      "grad_norm": 0.42836660146713257,
      "learning_rate": 2.26793967529228e-06,
      "loss": 0.0819,
      "mae_dtheta": 0.010087395086884499,
      "mae_dx": 0.002410013461485505,
      "mae_dy": 0.0013068282278254628,
      "pose_mae_dtheta": 0.07237948477268219,
      "pose_mae_dx": 0.02272304892539978,
      "pose_mae_dy": 0.01902155764400959,
      "pose_rmse_dtheta": 0.23858429491519928,
      "pose_rmse_dx": 0.06601083278656006,
      "pose_rmse_dy": 0.05599665269255638,
      "pose_rmse_mean": 0.12019725888967514,
      "rmse_dtheta": 0.02863013558089733,
      "rmse_dx": 0.008004686795175076,
      "rmse_dy": 0.003093295032158494,
      "rmse_mean": 0.013242705725133419,
      "rotation_flip": 0.0037553647998720407,
      "sparse_tokens": 32089.0,
      "step": 8247,
      "turn_loss": 0.09244159609079361,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.3832001486712507,
      "grad_norm": 0.3987954258918762,
      "learning_rate": 2.266832390519811e-06,
      "loss": 0.0912,
      "mae_dtheta": 0.008725859224796295,
      "mae_dx": 0.000963178463280201,
      "mae_dy": 0.0017572313081473112,
      "pose_mae_dtheta": 0.05871673673391342,
      "pose_mae_dx": 0.01694156788289547,
      "pose_mae_dy": 0.02531147375702858,
      "pose_rmse_dtheta": 0.14583852887153625,
      "pose_rmse_dx": 0.04778127372264862,
      "pose_rmse_dy": 0.06736457347869873,
      "pose_rmse_mean": 0.08699478954076767,
      "rmse_dtheta": 0.01940535195171833,
      "rmse_dx": 0.003628110745921731,
      "rmse_dy": 0.003977714106440544,
      "rmse_mean": 0.009003725834190845,
      "rotation_flip": 0.0038738239090889692,
      "sparse_tokens": 32025.0,
      "step": 8248,
      "turn_loss": 0.06781068444252014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.38324660843709346,
      "grad_norm": 0.35700470209121704,
      "learning_rate": 2.265725296879221e-06,
      "loss": 0.0881,
      "mae_dtheta": 0.011096916161477566,
      "mae_dx": 0.0016677970997989178,
      "mae_dy": 0.0024944106116890907,
      "pose_mae_dtheta": 0.07222533226013184,
      "pose_mae_dx": 0.024081122130155563,
      "pose_mae_dy": 0.03039269708096981,
      "pose_rmse_dtheta": 0.1838037520647049,
      "pose_rmse_dx": 0.07354801893234253,
      "pose_rmse_dy": 0.06985827535390854,
      "pose_rmse_mean": 0.10907001793384552,
      "rmse_dtheta": 0.023494280874729156,
      "rmse_dx": 0.005471595097333193,
      "rmse_dy": 0.005872215144336224,
      "rmse_mean": 0.011612697504460812,
      "rotation_flip": 0.0022865852806717157,
      "sparse_tokens": 32057.0,
      "step": 8249,
      "turn_loss": 0.09341131895780563,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.38329306820293624,
      "grad_norm": 0.5326899886131287,
      "learning_rate": 2.264618394447927e-06,
      "loss": 0.1064,
      "mae_dtheta": 0.036109138280153275,
      "mae_dx": 0.015398196876049042,
      "mae_dy": 0.017253216356039047,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5326899886131287,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 141.92764282226562,
      "model/head/act_norm_mean": 99.03196747448979,
      "model/head/act_norm_min": 50.37303924560547,
      "model/head/act_over_embed": 68.0556952003564,
      "model/head/grad_frac": 0.10310547798871994,
      "model/head/grad_norm": 0.05492325499653816,
      "model/head/grad_zero_frac": 0.0001830658147810027,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7012316645408163,
      "model/head/update_ratio": 0.000935660966206342,
      "model/head/weight_delta": 9.732826232910156,
      "model/head/weight_delta_rel": 0.17074260115623474,
      "model/head/weight_norm": 58.699954986572266,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42233356833457947,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42226638793945315,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42219728231430054,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901854151122017,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08191665261983871,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04363618046045303,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5469921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001409151591360569,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1072137355804443,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10152235627174377,
      "model/modality_embedder.encoders.pose/weight_norm": 30.966278076171875,
      "model/modality_embedder/grad_frac": 0.08191665261983871,
      "model/modality_embedder/grad_norm": 0.04363618046045303,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5469921875,
      "model/modality_embedder/update_ratio": 0.001409151591360569,
      "model/modality_embedder/weight_delta": 3.1072137355804443,
      "model/modality_embedder/weight_delta_rel": 0.10152235627174377,
      "model/modality_embedder/weight_norm": 30.966278076171875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.76690673828125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.708750911078717,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.491167068481445,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.605666228768934,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08438993245363235,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04495367035269737,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016093349549919367,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6170310974121094,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09536619484424591,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.933073043823242,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 79.39633178710938,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.46841846857791,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.788701057434082,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.127716886402105,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08727011829614639,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.046487919986248016,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015639237826690078,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.318174123764038,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11494414508342743,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.725183486938477,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.02864074707031,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.117109045999353,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.228965759277344,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.260712486490494,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08494668453931808,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04525024816393852,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001474230200983584,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.58860445022583,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12049861997365952,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.69415283203125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.77449798583984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.222080498866212,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.900096893310547,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.70726857595383,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08955933898687363,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.047707363963127136,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015945887425914407,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.076347827911377,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10513497143983841,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.91828727722168,
      "model/normalizer/grad_frac": 0.36712586879730225,
      "model/normalizer/grad_norm": 0.19556427001953125,
      "model/normalizer/grad_zero_frac": 0.00021862160065211356,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002487867372110486,
      "model/normalizer/weight_delta": 6.488008499145508,
      "model/normalizer/weight_delta_rel": 0.08356179296970367,
      "model/normalizer/weight_norm": 78.60719299316406,
      "pose_mae_dtheta": 0.28438517451286316,
      "pose_mae_dx": 0.1187610849738121,
      "pose_mae_dy": 0.18506678938865662,
      "pose_rmse_dtheta": 0.48910602927207947,
      "pose_rmse_dx": 0.21194443106651306,
      "pose_rmse_dy": 0.3534591794013977,
      "pose_rmse_mean": 0.3515032231807709,
      "rmse_dtheta": 0.054451290518045425,
      "rmse_dx": 0.027376819401979446,
      "rmse_dy": 0.0302581749856472,
      "rmse_mean": 0.03736209496855736,
      "rotation_flip": 0.013681592419743538,
      "sparse_tokens": 13478.0,
      "step": 8250,
      "turn_loss": 0.4924578070640564,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.383339527968779,
      "grad_norm": 0.3486078083515167,
      "learning_rate": 2.263511683303339e-06,
      "loss": 0.0864,
      "mae_dtheta": 0.010047662071883678,
      "mae_dx": 0.0011726421071216464,
      "mae_dy": 0.0017725506331771612,
      "pose_mae_dtheta": 0.06793156266212463,
      "pose_mae_dx": 0.016145285218954086,
      "pose_mae_dy": 0.022273723036050797,
      "pose_rmse_dtheta": 0.1919531375169754,
      "pose_rmse_dx": 0.04202161356806755,
      "pose_rmse_dy": 0.05352161452174187,
      "pose_rmse_mean": 0.09583212435245514,
      "rmse_dtheta": 0.02471226640045643,
      "rmse_dx": 0.003046833910048008,
      "rmse_dy": 0.00370980822481215,
      "rmse_mean": 0.010489637032151222,
      "rotation_flip": 0.004986574407666922,
      "sparse_tokens": 32121.0,
      "step": 8251,
      "turn_loss": 0.0712151974439621,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3833859877346218,
      "grad_norm": 0.5690155029296875,
      "learning_rate": 2.2624051635228463e-06,
      "loss": 0.0969,
      "mae_dtheta": 0.008634024299681187,
      "mae_dx": 0.0018925165059044957,
      "mae_dy": 0.002847743686288595,
      "pose_mae_dtheta": 0.054711904376745224,
      "pose_mae_dx": 0.02804829366505146,
      "pose_mae_dy": 0.024158548563718796,
      "pose_rmse_dtheta": 0.13698796927928925,
      "pose_rmse_dx": 0.08039294183254242,
      "pose_rmse_dy": 0.07762908935546875,
      "pose_rmse_mean": 0.09833666682243347,
      "rmse_dtheta": 0.01984376274049282,
      "rmse_dx": 0.004512312356382608,
      "rmse_dy": 0.006919745821505785,
      "rmse_mean": 0.010425273329019547,
      "rotation_flip": 0.005975395441055298,
      "sparse_tokens": 32169.0,
      "step": 8252,
      "turn_loss": 0.07100370526313782,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.3834324475004646,
      "grad_norm": 0.5329785346984863,
      "learning_rate": 2.261298835183831e-06,
      "loss": 0.1303,
      "mae_dtheta": 0.028418637812137604,
      "mae_dx": 0.012676612474024296,
      "mae_dy": 0.007533414755016565,
      "pose_mae_dtheta": 0.23116856813430786,
      "pose_mae_dx": 0.08038511127233505,
      "pose_mae_dy": 0.06308712810277939,
      "pose_rmse_dtheta": 0.3811913728713989,
      "pose_rmse_dx": 0.18641771376132965,
      "pose_rmse_dy": 0.16576234996318817,
      "pose_rmse_mean": 0.2444571554660797,
      "rmse_dtheta": 0.0447855144739151,
      "rmse_dx": 0.026502665132284164,
      "rmse_dy": 0.017922330647706985,
      "rmse_mean": 0.0297368373721838,
      "rotation_flip": 0.011782032437622547,
      "sparse_tokens": 10926.0,
      "step": 8253,
      "turn_loss": 0.30548614263534546,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3834789072663074,
      "grad_norm": 0.3982355296611786,
      "learning_rate": 2.260192698363657e-06,
      "loss": 0.0694,
      "mae_dtheta": 0.007510972674936056,
      "mae_dx": 0.0011673413682729006,
      "mae_dy": 0.0016644953284412622,
      "pose_mae_dtheta": 0.05264705419540405,
      "pose_mae_dx": 0.0161287784576416,
      "pose_mae_dy": 0.022937681525945663,
      "pose_rmse_dtheta": 0.13824333250522614,
      "pose_rmse_dx": 0.052407797425985336,
      "pose_rmse_dy": 0.0625726580619812,
      "pose_rmse_mean": 0.08440792560577393,
      "rmse_dtheta": 0.018493905663490295,
      "rmse_dx": 0.004214986227452755,
      "rmse_dy": 0.00463029695674777,
      "rmse_mean": 0.009113064035773277,
      "rotation_flip": 0.0016930022975429893,
      "sparse_tokens": 32057.0,
      "step": 8254,
      "turn_loss": 0.05724496394395828,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3835253670321502,
      "grad_norm": 0.3399801552295685,
      "learning_rate": 2.2590867531396793e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.009809073992073536,
      "mae_dx": 0.0014515365473926067,
      "mae_dy": 0.0028732146602123976,
      "pose_mae_dtheta": 0.0677686482667923,
      "pose_mae_dx": 0.02287309430539608,
      "pose_mae_dy": 0.033723022788763046,
      "pose_rmse_dtheta": 0.1524704098701477,
      "pose_rmse_dx": 0.06714682281017303,
      "pose_rmse_dy": 0.08507263660430908,
      "pose_rmse_mean": 0.10156329721212387,
      "rmse_dtheta": 0.021408740431070328,
      "rmse_dx": 0.005192434415221214,
      "rmse_dy": 0.007222023326903582,
      "rmse_mean": 0.011274400167167187,
      "rotation_flip": 0.002610966097563505,
      "sparse_tokens": 32041.0,
      "step": 8255,
      "turn_loss": 0.08571509271860123,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.38357182679799295,
      "grad_norm": 0.4763665497303009,
      "learning_rate": 2.2579809995892343e-06,
      "loss": 0.0772,
      "mae_dtheta": 0.007365562953054905,
      "mae_dx": 0.0014209904475137591,
      "mae_dy": 0.0021722065284848213,
      "pose_mae_dtheta": 0.047896549105644226,
      "pose_mae_dx": 0.01873132400214672,
      "pose_mae_dy": 0.02268887497484684,
      "pose_rmse_dtheta": 0.10440046340227127,
      "pose_rmse_dx": 0.052043091505765915,
      "pose_rmse_dy": 0.053435731679201126,
      "pose_rmse_mean": 0.06995975971221924,
      "rmse_dtheta": 0.015429075807332993,
      "rmse_dx": 0.0037647858262062073,
      "rmse_dy": 0.004751504398882389,
      "rmse_mean": 0.007981788367033005,
      "rotation_flip": 0.004115226212888956,
      "sparse_tokens": 32121.0,
      "step": 8256,
      "turn_loss": 0.06850332021713257,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.38361828656383573,
      "grad_norm": 0.7129701972007751,
      "learning_rate": 2.2568754377896516e-06,
      "loss": 0.1395,
      "mae_dtheta": 0.008871217258274555,
      "mae_dx": 0.0016111230943351984,
      "mae_dy": 0.002353502670302987,
      "pose_mae_dtheta": 0.05771888419985771,
      "pose_mae_dx": 0.018843473866581917,
      "pose_mae_dy": 0.024015558883547783,
      "pose_rmse_dtheta": 0.11856318265199661,
      "pose_rmse_dx": 0.051016032695770264,
      "pose_rmse_dy": 0.05114411562681198,
      "pose_rmse_mean": 0.07357444614171982,
      "rmse_dtheta": 0.018778882920742035,
      "rmse_dx": 0.005351229105144739,
      "rmse_dy": 0.005754570011049509,
      "rmse_mean": 0.009961560368537903,
      "rotation_flip": 0.004638833459466696,
      "sparse_tokens": 32153.0,
      "step": 8257,
      "turn_loss": 0.08100371807813644,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3836647463296785,
      "grad_norm": 0.6141016483306885,
      "learning_rate": 2.25577006781824e-06,
      "loss": 0.1648,
      "mae_dtheta": 0.008002717979252338,
      "mae_dx": 0.001263252692297101,
      "mae_dy": 0.002056174213066697,
      "pose_mae_dtheta": 0.04915352538228035,
      "pose_mae_dx": 0.016724279150366783,
      "pose_mae_dy": 0.023321107029914856,
      "pose_rmse_dtheta": 0.09882296621799469,
      "pose_rmse_dx": 0.04570891708135605,
      "pose_rmse_dy": 0.05777762085199356,
      "pose_rmse_mean": 0.06743650138378143,
      "rmse_dtheta": 0.01677132397890091,
      "rmse_dx": 0.0036510219797492027,
      "rmse_dy": 0.004973856266587973,
      "rmse_mean": 0.008465401828289032,
      "rotation_flip": 0.003884333185851574,
      "sparse_tokens": 32089.0,
      "step": 8258,
      "turn_loss": 0.08046133071184158,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3837112060955213,
      "grad_norm": 0.6009684205055237,
      "learning_rate": 2.254664889752303e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.008587111718952656,
      "mae_dx": 0.0010470858542248607,
      "mae_dy": 0.001347684534266591,
      "pose_mae_dtheta": 0.05269739776849747,
      "pose_mae_dx": 0.01284590270370245,
      "pose_mae_dy": 0.015378004871308804,
      "pose_rmse_dtheta": 0.18695031106472015,
      "pose_rmse_dx": 0.031136445701122284,
      "pose_rmse_dy": 0.03558522090315819,
      "pose_rmse_mean": 0.08455732464790344,
      "rmse_dtheta": 0.024158619344234467,
      "rmse_dx": 0.003058912931010127,
      "rmse_dy": 0.0032227078918367624,
      "rmse_mean": 0.010146746411919594,
      "rotation_flip": 0.006236080080270767,
      "sparse_tokens": 32105.0,
      "step": 8259,
      "turn_loss": 0.06402714550495148,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.38375766586136406,
      "grad_norm": 0.6801161170005798,
      "learning_rate": 2.2535599036691215e-06,
      "loss": 0.1522,
      "mae_dtheta": 0.011328775435686111,
      "mae_dx": 0.0010370375821366906,
      "mae_dy": 0.0025049042887985706,
      "pose_mae_dtheta": 0.07646950334310532,
      "pose_mae_dx": 0.023706400766968727,
      "pose_mae_dy": 0.038723260164260864,
      "pose_rmse_dtheta": 0.14118549227714539,
      "pose_rmse_dx": 0.06442933529615402,
      "pose_rmse_dy": 0.0863148421049118,
      "pose_rmse_mean": 0.0973098874092102,
      "rmse_dtheta": 0.019888611510396004,
      "rmse_dx": 0.0031319556292146444,
      "rmse_dy": 0.005061513744294643,
      "rmse_mean": 0.009360693395137787,
      "rotation_flip": 0.006143838167190552,
      "sparse_tokens": 32057.0,
      "step": 8260,
      "turn_loss": 0.09129257500171661,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.38380412562720684,
      "grad_norm": 0.4861082136631012,
      "learning_rate": 2.2524551096459703e-06,
      "loss": 0.0878,
      "mae_dtheta": 0.010887924581766129,
      "mae_dx": 0.0017042706022039056,
      "mae_dy": 0.0024456388782709837,
      "pose_mae_dtheta": 0.0718880221247673,
      "pose_mae_dx": 0.020761165767908096,
      "pose_mae_dy": 0.029702914878726006,
      "pose_rmse_dtheta": 0.1813736855983734,
      "pose_rmse_dx": 0.05736580118536949,
      "pose_rmse_dy": 0.09680198132991791,
      "pose_rmse_mean": 0.1118471622467041,
      "rmse_dtheta": 0.023141730576753616,
      "rmse_dx": 0.004521891009062529,
      "rmse_dy": 0.005961121991276741,
      "rmse_mean": 0.011208249256014824,
      "rotation_flip": 0.00393830006942153,
      "sparse_tokens": 32201.0,
      "step": 8261,
      "turn_loss": 0.08709074556827545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3838505853930496,
      "grad_norm": 0.41896477341651917,
      "learning_rate": 2.2513505077601095e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.010022575035691261,
      "mae_dx": 0.00144242646638304,
      "mae_dy": 0.0021589251700788736,
      "pose_mae_dtheta": 0.06491861492395401,
      "pose_mae_dx": 0.01860087178647518,
      "pose_mae_dy": 0.026964006945490837,
      "pose_rmse_dtheta": 0.17627905309200287,
      "pose_rmse_dx": 0.05000653117895126,
      "pose_rmse_dy": 0.07460086792707443,
      "pose_rmse_mean": 0.10029548406600952,
      "rmse_dtheta": 0.0217878594994545,
      "rmse_dx": 0.003540425095707178,
      "rmse_dy": 0.004753519780933857,
      "rmse_mean": 0.010027268901467323,
      "rotation_flip": 0.01092896144837141,
      "sparse_tokens": 32121.0,
      "step": 8262,
      "turn_loss": 0.08104123920202255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3838970451588924,
      "grad_norm": 0.5187386870384216,
      "learning_rate": 2.2502460980887807e-06,
      "loss": 0.0702,
      "mae_dtheta": 0.003442478133365512,
      "mae_dx": 0.002194431144744158,
      "mae_dy": 0.00025071005802601576,
      "pose_mae_dtheta": 0.02387996017932892,
      "pose_mae_dx": 0.014433996751904488,
      "pose_mae_dy": 0.003426128998398781,
      "pose_rmse_dtheta": 0.13865722715854645,
      "pose_rmse_dx": 0.0737011730670929,
      "pose_rmse_dy": 0.0076817357912659645,
      "pose_rmse_mean": 0.07334671914577484,
      "rmse_dtheta": 0.016656817868351936,
      "rmse_dx": 0.009133354760706425,
      "rmse_dy": 0.0004960994119755924,
      "rmse_mean": 0.008762091398239136,
      "rotation_flip": 0.0018382353009656072,
      "sparse_tokens": 32073.0,
      "step": 8263,
      "turn_loss": 0.030821669846773148,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.38394350492473517,
      "grad_norm": 0.5479945540428162,
      "learning_rate": 2.2491418807092208e-06,
      "loss": 0.1021,
      "mae_dtheta": 0.034837208688259125,
      "mae_dx": 0.012914246879518032,
      "mae_dy": 0.010706039145588875,
      "pose_mae_dtheta": 0.2748750150203705,
      "pose_mae_dx": 0.09267742186784744,
      "pose_mae_dy": 0.11729507893323898,
      "pose_rmse_dtheta": 0.4634948968887329,
      "pose_rmse_dx": 0.19227363169193268,
      "pose_rmse_dy": 0.2550949454307556,
      "pose_rmse_mean": 0.30362117290496826,
      "rmse_dtheta": 0.05133931711316109,
      "rmse_dx": 0.02417488768696785,
      "rmse_dy": 0.01990346983075142,
      "rmse_mean": 0.031805895268917084,
      "rotation_flip": 0.01326699834316969,
      "sparse_tokens": 9980.0,
      "step": 8264,
      "turn_loss": 0.322635293006897,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.38398996469057795,
      "grad_norm": 0.44112706184387207,
      "learning_rate": 2.248037855698643e-06,
      "loss": 0.0938,
      "mae_dtheta": 0.0075006382539868355,
      "mae_dx": 0.0015096119605004787,
      "mae_dy": 0.0015669125132262707,
      "pose_mae_dtheta": 0.05169104039669037,
      "pose_mae_dx": 0.017523230984807014,
      "pose_mae_dy": 0.019149286672472954,
      "pose_rmse_dtheta": 0.12776882946491241,
      "pose_rmse_dx": 0.04484444856643677,
      "pose_rmse_dy": 0.051055580377578735,
      "pose_rmse_mean": 0.07455629110336304,
      "rmse_dtheta": 0.019589688628911972,
      "rmse_dx": 0.00456204591318965,
      "rmse_dy": 0.004291383549571037,
      "rmse_mean": 0.009481039829552174,
      "rotation_flip": 0.00482121342793107,
      "sparse_tokens": 32169.0,
      "step": 8265,
      "turn_loss": 0.06405674666166306,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3840364244564207,
      "grad_norm": 0.6090076565742493,
      "learning_rate": 2.246934023134257e-06,
      "loss": 0.1361,
      "mae_dtheta": 0.010161515325307846,
      "mae_dx": 0.001293711713515222,
      "mae_dy": 0.0021854795049875975,
      "pose_mae_dtheta": 0.07024068385362625,
      "pose_mae_dx": 0.019710976630449295,
      "pose_mae_dy": 0.030460890382528305,
      "pose_rmse_dtheta": 0.17231537401676178,
      "pose_rmse_dx": 0.06377078592777252,
      "pose_rmse_dy": 0.07656536996364594,
      "pose_rmse_mean": 0.10421717166900635,
      "rmse_dtheta": 0.022003142163157463,
      "rmse_dx": 0.005163660738617182,
      "rmse_dy": 0.004989056847989559,
      "rmse_mean": 0.010718620382249355,
      "rotation_flip": 0.002466091187670827,
      "sparse_tokens": 32057.0,
      "step": 8266,
      "turn_loss": 0.07807549834251404,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24663.0,
      "epoch": 0.3840828842222635,
      "grad_norm": 0.9479575157165527,
      "learning_rate": 2.2458303830932515e-06,
      "loss": 0.2637,
      "mae_dtheta": 0.030440762639045715,
      "mae_dx": 0.010409684851765633,
      "mae_dy": 0.0044504450634121895,
      "pose_mae_dtheta": 0.23627856373786926,
      "pose_mae_dx": 0.07744491100311279,
      "pose_mae_dy": 0.04216017201542854,
      "pose_rmse_dtheta": 0.46116146445274353,
      "pose_rmse_dx": 0.20399467647075653,
      "pose_rmse_dy": 0.09987924993038177,
      "pose_rmse_mean": 0.25501179695129395,
      "rmse_dtheta": 0.050441063940525055,
      "rmse_dx": 0.023295409977436066,
      "rmse_dy": 0.010955747216939926,
      "rmse_mean": 0.028230741620063782,
      "rotation_flip": 0.014828545041382313,
      "sparse_tokens": 19861.0,
      "step": 8267,
      "turn_loss": 0.268688440322876,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.3841293439881063,
      "grad_norm": 0.6092510223388672,
      "learning_rate": 2.244726935652805e-06,
      "loss": 0.1183,
      "mae_dtheta": 0.02720116451382637,
      "mae_dx": 0.009317373856902122,
      "mae_dy": 0.004283340182155371,
      "pose_mae_dtheta": 0.17526976764202118,
      "pose_mae_dx": 0.07579115033149719,
      "pose_mae_dy": 0.06092393025755882,
      "pose_rmse_dtheta": 0.3503304123878479,
      "pose_rmse_dx": 0.18445810675621033,
      "pose_rmse_dy": 0.13360324501991272,
      "pose_rmse_mean": 0.2227972447872162,
      "rmse_dtheta": 0.04760575294494629,
      "rmse_dx": 0.021879179403185844,
      "rmse_dy": 0.007855391129851341,
      "rmse_mean": 0.02578010968863964,
      "rotation_flip": 0.013182674534618855,
      "sparse_tokens": 9850.0,
      "step": 8268,
      "turn_loss": 0.19123943150043488,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.3841758037539491,
      "grad_norm": 0.5449750423431396,
      "learning_rate": 2.2436236808900846e-06,
      "loss": 0.1704,
      "mae_dtheta": 0.03434962034225464,
      "mae_dx": 0.006191013380885124,
      "mae_dy": 0.001230680150911212,
      "pose_mae_dtheta": 0.2944323420524597,
      "pose_mae_dx": 0.04419101029634476,
      "pose_mae_dy": 0.011226950213313103,
      "pose_rmse_dtheta": 0.523293137550354,
      "pose_rmse_dx": 0.10283180326223373,
      "pose_rmse_dy": 0.027165060862898827,
      "pose_rmse_mean": 0.21776333451271057,
      "rmse_dtheta": 0.05589539557695389,
      "rmse_dx": 0.014278438873589039,
      "rmse_dy": 0.0031678618397563696,
      "rmse_mean": 0.024447232484817505,
      "rotation_flip": 0.0,
      "sparse_tokens": 5032.0,
      "step": 8269,
      "turn_loss": 0.19921472668647766,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3842222635197919,
      "grad_norm": 0.5560394525527954,
      "learning_rate": 2.2425206188822375e-06,
      "loss": 0.1515,
      "mae_dtheta": 0.0151939382776618,
      "mae_dx": 0.005514512769877911,
      "mae_dy": 0.006202290300279856,
      "pose_mae_dtheta": 0.1144416332244873,
      "pose_mae_dx": 0.05647223815321922,
      "pose_mae_dy": 0.03885249048471451,
      "pose_rmse_dtheta": 0.24817685782909393,
      "pose_rmse_dx": 0.13715068995952606,
      "pose_rmse_dy": 0.08043944090604782,
      "pose_rmse_mean": 0.15525567531585693,
      "rmse_dtheta": 0.029441066086292267,
      "rmse_dx": 0.012192190624773502,
      "rmse_dy": 0.011682651937007904,
      "rmse_mean": 0.017771970480680466,
      "rotation_flip": 0.010051694698631763,
      "sparse_tokens": 32185.0,
      "step": 8270,
      "turn_loss": 0.18846268951892853,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.38426872328563466,
      "grad_norm": 0.512341320514679,
      "learning_rate": 2.241417749706406e-06,
      "loss": 0.1122,
      "mae_dtheta": 0.010611248202621937,
      "mae_dx": 0.001879745745100081,
      "mae_dy": 0.003058407688513398,
      "pose_mae_dtheta": 0.06409414857625961,
      "pose_mae_dx": 0.02500958926975727,
      "pose_mae_dy": 0.034446004778146744,
      "pose_rmse_dtheta": 0.13210095465183258,
      "pose_rmse_dx": 0.06727999448776245,
      "pose_rmse_dy": 0.07355891168117523,
      "pose_rmse_mean": 0.09097995609045029,
      "rmse_dtheta": 0.01999877206981182,
      "rmse_dx": 0.006073006894439459,
      "rmse_dy": 0.006252476945519447,
      "rmse_mean": 0.010774752125144005,
      "rotation_flip": 0.0055432370863854885,
      "sparse_tokens": 32057.0,
      "step": 8271,
      "turn_loss": 0.08928704261779785,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.38431518305147744,
      "grad_norm": 0.5040836930274963,
      "learning_rate": 2.2403150734397095e-06,
      "loss": 0.1305,
      "mae_dtheta": 0.030981779098510742,
      "mae_dx": 0.01431247591972351,
      "mae_dy": 0.0061159441247582436,
      "pose_mae_dtheta": 0.20959700644016266,
      "pose_mae_dx": 0.12487240135669708,
      "pose_mae_dy": 0.07672610133886337,
      "pose_rmse_dtheta": 0.3513549268245697,
      "pose_rmse_dx": 0.2825767397880554,
      "pose_rmse_dy": 0.16281889379024506,
      "pose_rmse_mean": 0.26558351516723633,
      "rmse_dtheta": 0.046513497829437256,
      "rmse_dx": 0.028578588739037514,
      "rmse_dy": 0.011702435091137886,
      "rmse_mean": 0.028931505978107452,
      "rotation_flip": 0.012077294290065765,
      "sparse_tokens": 13104.0,
      "step": 8272,
      "turn_loss": 0.28619909286499023,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3843616428173202,
      "grad_norm": 0.5213690996170044,
      "learning_rate": 2.2392125901592615e-06,
      "loss": 0.0909,
      "mae_dtheta": 0.01103254035115242,
      "mae_dx": 0.002225063042715192,
      "mae_dy": 0.003607204183936119,
      "pose_mae_dtheta": 0.0712500810623169,
      "pose_mae_dx": 0.02989787794649601,
      "pose_mae_dy": 0.03254985436797142,
      "pose_rmse_dtheta": 0.1508794128894806,
      "pose_rmse_dx": 0.07207571715116501,
      "pose_rmse_dy": 0.06781851500272751,
      "pose_rmse_mean": 0.0969245582818985,
      "rmse_dtheta": 0.021464256569743156,
      "rmse_dx": 0.005209497641772032,
      "rmse_dy": 0.007143897470086813,
      "rmse_mean": 0.011272551491856575,
      "rotation_flip": 0.005884174723178148,
      "sparse_tokens": 32121.0,
      "step": 8273,
      "turn_loss": 0.09109226614236832,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.384408102583163,
      "grad_norm": 0.4762739837169647,
      "learning_rate": 2.2381102999421607e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.03861982747912407,
      "mae_dx": 0.008738778531551361,
      "mae_dy": 0.007702729199081659,
      "pose_mae_dtheta": 0.32003772258758545,
      "pose_mae_dx": 0.07594726979732513,
      "pose_mae_dy": 0.06719188392162323,
      "pose_rmse_dtheta": 0.6190586090087891,
      "pose_rmse_dx": 0.18207520246505737,
      "pose_rmse_dy": 0.16809113323688507,
      "pose_rmse_mean": 0.32307499647140503,
      "rmse_dtheta": 0.06296361982822418,
      "rmse_dx": 0.018613778054714203,
      "rmse_dy": 0.017899347469210625,
      "rmse_mean": 0.03315891698002815,
      "rotation_flip": 0.002971768146380782,
      "sparse_tokens": 11827.0,
      "step": 8274,
      "turn_loss": 0.3172115683555603,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.38445456234900577,
      "grad_norm": 0.5122269988059998,
      "learning_rate": 2.2370082028654867e-06,
      "loss": 0.143,
      "mae_dtheta": 0.011186528950929642,
      "mae_dx": 0.002078310353681445,
      "mae_dy": 0.003397048218175769,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.512226939201355,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.9687957763672,
      "model/head/act_norm_mean": 101.57121014835859,
      "model/head/act_norm_min": 61.0432243347168,
      "model/head/act_over_embed": 69.8006865386035,
      "model/head/grad_frac": 0.11546122282743454,
      "model/head/grad_norm": 0.0591423474252224,
      "model/head/grad_zero_frac": 0.0001675194944255054,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7026120580808081,
      "model/head/update_ratio": 0.0010075232712551951,
      "model/head/weight_delta": 9.737789154052734,
      "model/head/weight_delta_rel": 0.1708296686410904,
      "model/head/weight_norm": 58.70072555541992,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4222955107688904,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42223144116984235,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42215496301651,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29016139936494834,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06466946005821228,
      "model/modality_embedder.encoders.pose/grad_norm": 0.033125437796115875,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5367735435520362,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001069727004505694,
      "model/modality_embedder.encoders.pose/weight_delta": 3.107316732406616,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10152572393417358,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96625518798828,
      "model/modality_embedder/grad_frac": 0.06466946005821228,
      "model/modality_embedder/grad_norm": 0.033125437796115875,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5367735435520362,
      "model/modality_embedder/update_ratio": 0.001069727004505694,
      "model/modality_embedder/weight_delta": 3.107316732406616,
      "model/modality_embedder/weight_delta_rel": 0.10152572393417358,
      "model/modality_embedder/weight_norm": 30.96625518798828,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.30626678466797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.894493045534713,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.94146728515625,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.733309962512354,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0912667065858841,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.046749264001846313,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016735958633944392,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6193246841430664,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0954497754573822,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.93342399597168,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.69527435302734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.871705647747316,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.334046363830566,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.404859611561378,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08760299533605576,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04487261548638344,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015095383860170841,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3211629390716553,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11504767835140228,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.726051330566406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.27107238769531,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.790068342151674,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.124934196472168,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.72317641515056,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08722472935914993,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04467885568737984,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014555786037817597,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.591789484024048,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12060556560754776,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.694910049438477,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.64542388916016,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.625433401475068,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.26308536529541,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.984456466876008,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07615772634744644,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03901004046201706,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013038539327681065,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.079505443572998,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10524288564920425,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.91902732849121,
      "model/normalizer/grad_frac": 0.2915334403514862,
      "model/normalizer/grad_norm": 0.14933128654956818,
      "model/normalizer/grad_zero_frac": 0.00021389465837273747,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00189969374332577,
      "model/normalizer/weight_delta": 6.494001865386963,
      "model/normalizer/weight_delta_rel": 0.0836389809846878,
      "model/normalizer/weight_norm": 78.60808563232422,
      "pose_mae_dtheta": 0.07224652916193008,
      "pose_mae_dx": 0.028863834217190742,
      "pose_mae_dy": 0.026869002729654312,
      "pose_rmse_dtheta": 0.2089604288339615,
      "pose_rmse_dx": 0.06905803084373474,
      "pose_rmse_dy": 0.05503617972135544,
      "pose_rmse_mean": 0.11101822555065155,
      "rmse_dtheta": 0.025672458112239838,
      "rmse_dx": 0.005205587483942509,
      "rmse_dy": 0.006912147160619497,
      "rmse_mean": 0.012596730142831802,
      "rotation_flip": 0.005089058540761471,
      "sparse_tokens": 32089.0,
      "step": 8275,
      "turn_loss": 0.08914260566234589,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.38450102211484855,
      "grad_norm": 0.40975257754325867,
      "learning_rate": 2.235906299006314e-06,
      "loss": 0.0708,
      "mae_dtheta": 0.0071392483077943325,
      "mae_dx": 0.0014213494723662734,
      "mae_dy": 0.00025306298630312085,
      "pose_mae_dtheta": 0.050707004964351654,
      "pose_mae_dx": 0.01083382312208414,
      "pose_mae_dy": 0.003654584288597107,
      "pose_rmse_dtheta": 0.22138695418834686,
      "pose_rmse_dx": 0.02808883972465992,
      "pose_rmse_dy": 0.0076318783685564995,
      "pose_rmse_mean": 0.0857025608420372,
      "rmse_dtheta": 0.027792347595095634,
      "rmse_dx": 0.004299649503082037,
      "rmse_dy": 0.00046862350427545607,
      "rmse_mean": 0.010853540152311325,
      "rotation_flip": 0.0,
      "sparse_tokens": 32169.0,
      "step": 8276,
      "turn_loss": 0.032601986080408096,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3845474818806913,
      "grad_norm": 0.3783803880214691,
      "learning_rate": 2.234804588441696e-06,
      "loss": 0.0798,
      "mae_dtheta": 0.007197815924882889,
      "mae_dx": 0.001751720905303955,
      "mae_dy": 0.0015998680610209703,
      "pose_mae_dtheta": 0.04801415279507637,
      "pose_mae_dx": 0.016349826008081436,
      "pose_mae_dy": 0.020956924185156822,
      "pose_rmse_dtheta": 0.14033544063568115,
      "pose_rmse_dx": 0.04937589541077614,
      "pose_rmse_dy": 0.05695444718003273,
      "pose_rmse_mean": 0.08222192525863647,
      "rmse_dtheta": 0.017228415235877037,
      "rmse_dx": 0.006397200748324394,
      "rmse_dy": 0.004161702934652567,
      "rmse_mean": 0.009262439794838428,
      "rotation_flip": 0.0031138788908720016,
      "sparse_tokens": 32121.0,
      "step": 8277,
      "turn_loss": 0.0667181983590126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.3845939416465341,
      "grad_norm": 0.7109726667404175,
      "learning_rate": 2.233703071248679e-06,
      "loss": 0.1713,
      "mae_dtheta": 0.03419378399848938,
      "mae_dx": 0.01224503479897976,
      "mae_dy": 0.007170282769948244,
      "pose_mae_dtheta": 0.27167436480522156,
      "pose_mae_dx": 0.10327117890119553,
      "pose_mae_dy": 0.057849202305078506,
      "pose_rmse_dtheta": 0.4910011887550354,
      "pose_rmse_dx": 0.23524577915668488,
      "pose_rmse_dy": 0.13460023701190948,
      "pose_rmse_mean": 0.2869490683078766,
      "rmse_dtheta": 0.05340086668729782,
      "rmse_dx": 0.025365810841321945,
      "rmse_dy": 0.016498291864991188,
      "rmse_mean": 0.0317549891769886,
      "rotation_flip": 0.015548281371593475,
      "sparse_tokens": 25024.0,
      "step": 8278,
      "turn_loss": 0.2929432988166809,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.3846404014123769,
      "grad_norm": 0.8039263486862183,
      "learning_rate": 2.232601747504289e-06,
      "loss": 0.1448,
      "mae_dtheta": 0.04309811815619469,
      "mae_dx": 0.010406911373138428,
      "mae_dy": 0.012219224125146866,
      "pose_mae_dtheta": 0.33663347363471985,
      "pose_mae_dx": 0.0654991865158081,
      "pose_mae_dy": 0.12679947912693024,
      "pose_rmse_dtheta": 0.56065434217453,
      "pose_rmse_dx": 0.14061684906482697,
      "pose_rmse_dy": 0.3031689524650574,
      "pose_rmse_mean": 0.33481335639953613,
      "rmse_dtheta": 0.060191571712493896,
      "rmse_dx": 0.02049787901341915,
      "rmse_dy": 0.022965140640735626,
      "rmse_mean": 0.034551531076431274,
      "rotation_flip": 0.009009009227156639,
      "sparse_tokens": 5074.0,
      "step": 8279,
      "turn_loss": 0.37206315994262695,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.38468686117821965,
      "grad_norm": 0.5068464875221252,
      "learning_rate": 2.2315006172855443e-06,
      "loss": 0.113,
      "mae_dtheta": 0.031601402908563614,
      "mae_dx": 0.01474700402468443,
      "mae_dy": 0.013424132950603962,
      "pose_mae_dtheta": 0.23659169673919678,
      "pose_mae_dx": 0.12522198259830475,
      "pose_mae_dy": 0.1278059184551239,
      "pose_rmse_dtheta": 0.4606193006038666,
      "pose_rmse_dx": 0.2330421358346939,
      "pose_rmse_dy": 0.24512481689453125,
      "pose_rmse_mean": 0.3129287660121918,
      "rmse_dtheta": 0.05013947933912277,
      "rmse_dx": 0.025203702971339226,
      "rmse_dy": 0.022231850773096085,
      "rmse_mean": 0.032525014132261276,
      "rotation_flip": 0.002958579920232296,
      "sparse_tokens": 5702.0,
      "step": 8280,
      "turn_loss": 0.35200953483581543,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 14295.0,
      "epoch": 0.38473332094406243,
      "grad_norm": 0.9391167759895325,
      "learning_rate": 2.230399680669449e-06,
      "loss": 0.2292,
      "mae_dtheta": 0.024037713184952736,
      "mae_dx": 0.006146612111479044,
      "mae_dy": 0.003458293154835701,
      "pose_mae_dtheta": 0.1790255606174469,
      "pose_mae_dx": 0.047841425985097885,
      "pose_mae_dy": 0.0351230688393116,
      "pose_rmse_dtheta": 0.33316418528556824,
      "pose_rmse_dx": 0.1523951292037964,
      "pose_rmse_dy": 0.07977811992168427,
      "pose_rmse_mean": 0.1884458065032959,
      "rmse_dtheta": 0.041066840291023254,
      "rmse_dx": 0.01748580113053322,
      "rmse_dy": 0.007671050727367401,
      "rmse_mean": 0.022074565291404724,
      "rotation_flip": 0.018987340852618217,
      "sparse_tokens": 11660.0,
      "step": 8281,
      "turn_loss": 0.18281659483909607,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3847797807099052,
      "grad_norm": 0.4104383587837219,
      "learning_rate": 2.2292989377329887e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.009528964757919312,
      "mae_dx": 0.0021970681846141815,
      "mae_dy": 0.0025679473765194416,
      "pose_mae_dtheta": 0.06445176899433136,
      "pose_mae_dx": 0.02469569258391857,
      "pose_mae_dy": 0.026228532195091248,
      "pose_rmse_dtheta": 0.14938074350357056,
      "pose_rmse_dx": 0.07385317236185074,
      "pose_rmse_dy": 0.06216045096516609,
      "pose_rmse_mean": 0.09513145685195923,
      "rmse_dtheta": 0.020902985706925392,
      "rmse_dx": 0.006383026950061321,
      "rmse_dy": 0.006410208996385336,
      "rmse_mean": 0.011232073418796062,
      "rotation_flip": 0.006092917174100876,
      "sparse_tokens": 32105.0,
      "step": 8282,
      "turn_loss": 0.09043838828802109,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.384826240475748,
      "grad_norm": 0.8840421438217163,
      "learning_rate": 2.2281983885531428e-06,
      "loss": 0.1582,
      "mae_dtheta": 0.04925064742565155,
      "mae_dx": 0.00991788785904646,
      "mae_dy": 0.0027957200072705746,
      "pose_mae_dtheta": 0.3972516357898712,
      "pose_mae_dx": 0.08030980080366135,
      "pose_mae_dy": 0.024729464203119278,
      "pose_rmse_dtheta": 0.6537110209465027,
      "pose_rmse_dx": 0.17109893262386322,
      "pose_rmse_dy": 0.06363485008478165,
      "pose_rmse_mean": 0.29614830017089844,
      "rmse_dtheta": 0.06891713291406631,
      "rmse_dx": 0.02080787904560566,
      "rmse_dy": 0.006696199532598257,
      "rmse_mean": 0.03214040398597717,
      "rotation_flip": 0.014672686345875263,
      "sparse_tokens": 14476.0,
      "step": 8283,
      "turn_loss": 0.3096559941768646,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.38487270024159076,
      "grad_norm": 0.39963704347610474,
      "learning_rate": 2.2270980332068698e-06,
      "loss": 0.0709,
      "mae_dtheta": 0.011633602902293205,
      "mae_dx": 0.0014723723288625479,
      "mae_dy": 0.002223632298409939,
      "pose_mae_dtheta": 0.08616761863231659,
      "pose_mae_dx": 0.018227897584438324,
      "pose_mae_dy": 0.025485390797257423,
      "pose_rmse_dtheta": 0.23229286074638367,
      "pose_rmse_dx": 0.045724056661129,
      "pose_rmse_dy": 0.054431550204753876,
      "pose_rmse_mean": 0.11081616580486298,
      "rmse_dtheta": 0.027537312358617783,
      "rmse_dx": 0.004898592829704285,
      "rmse_dy": 0.005729866214096546,
      "rmse_mean": 0.012721924111247063,
      "rotation_flip": 0.0066955494694411755,
      "sparse_tokens": 32073.0,
      "step": 8284,
      "turn_loss": 0.08770196884870529,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.38491916000743354,
      "grad_norm": 0.4778374433517456,
      "learning_rate": 2.225997871771121e-06,
      "loss": 0.0938,
      "mae_dtheta": 0.02976226434111595,
      "mae_dx": 0.007546566426753998,
      "mae_dy": 0.006736743729561567,
      "pose_mae_dtheta": 0.22536589205265045,
      "pose_mae_dx": 0.09744689613580704,
      "pose_mae_dy": 0.12847380340099335,
      "pose_rmse_dtheta": 0.3043176233768463,
      "pose_rmse_dx": 0.16023550927639008,
      "pose_rmse_dy": 0.20979461073875427,
      "pose_rmse_mean": 0.22478258609771729,
      "rmse_dtheta": 0.04060449078679085,
      "rmse_dx": 0.01491693314164877,
      "rmse_dy": 0.010518193244934082,
      "rmse_mean": 0.022013207897543907,
      "rotation_flip": 0.008695651777088642,
      "sparse_tokens": 3794.0,
      "step": 8285,
      "turn_loss": 0.26819151639938354,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.38496561977327637,
      "grad_norm": 0.3893063962459564,
      "learning_rate": 2.224897904322828e-06,
      "loss": 0.0758,
      "mae_dtheta": 0.012173759751021862,
      "mae_dx": 0.003665932919830084,
      "mae_dy": 0.002820590976625681,
      "pose_mae_dtheta": 0.08580438792705536,
      "pose_mae_dx": 0.035956814885139465,
      "pose_mae_dy": 0.03220127895474434,
      "pose_rmse_dtheta": 0.23151907324790955,
      "pose_rmse_dx": 0.11407283693552017,
      "pose_rmse_dy": 0.0824926421046257,
      "pose_rmse_mean": 0.1426948606967926,
      "rmse_dtheta": 0.027067450806498528,
      "rmse_dx": 0.011469220742583275,
      "rmse_dy": 0.006842757109552622,
      "rmse_mean": 0.015126476995646954,
      "rotation_flip": 0.005754758603870869,
      "sparse_tokens": 32121.0,
      "step": 8286,
      "turn_loss": 0.10713399946689606,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.38501207953911915,
      "grad_norm": 0.6466535925865173,
      "learning_rate": 2.223798130938916e-06,
      "loss": 0.1258,
      "mae_dtheta": 0.014065169729292393,
      "mae_dx": 0.0016820310847833753,
      "mae_dy": 0.0036110379733145237,
      "pose_mae_dtheta": 0.09319037944078445,
      "pose_mae_dx": 0.02411969192326069,
      "pose_mae_dy": 0.038360193371772766,
      "pose_rmse_dtheta": 0.22380882501602173,
      "pose_rmse_dx": 0.06077522411942482,
      "pose_rmse_dy": 0.0880143791437149,
      "pose_rmse_mean": 0.12419947236776352,
      "rmse_dtheta": 0.028881385922431946,
      "rmse_dx": 0.004132126923650503,
      "rmse_dy": 0.007292682304978371,
      "rmse_mean": 0.013435399159789085,
      "rotation_flip": 0.007103648502379656,
      "sparse_tokens": 32121.0,
      "step": 8287,
      "turn_loss": 0.10092142224311829,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.3850585393049619,
      "grad_norm": 0.7856352925300598,
      "learning_rate": 2.2226985516962897e-06,
      "loss": 0.2538,
      "mae_dtheta": 0.025065232068300247,
      "mae_dx": 0.009441069327294827,
      "mae_dy": 0.003666504519060254,
      "pose_mae_dtheta": 0.1906835436820984,
      "pose_mae_dx": 0.0906800702214241,
      "pose_mae_dy": 0.04440292716026306,
      "pose_rmse_dtheta": 0.329622745513916,
      "pose_rmse_dx": 0.17696940898895264,
      "pose_rmse_dy": 0.10555333644151688,
      "pose_rmse_mean": 0.2040484994649887,
      "rmse_dtheta": 0.03833610936999321,
      "rmse_dx": 0.01856493204832077,
      "rmse_dy": 0.007665863260626793,
      "rmse_mean": 0.02152230218052864,
      "rotation_flip": 0.008752735331654549,
      "sparse_tokens": 8278.0,
      "step": 8288,
      "turn_loss": 0.237839937210083,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.3851049990708047,
      "grad_norm": 0.9696099758148193,
      "learning_rate": 2.221599166671845e-06,
      "loss": 0.1395,
      "mae_dtheta": 0.03433620557188988,
      "mae_dx": 0.0190835352987051,
      "mae_dy": 0.009288118220865726,
      "pose_mae_dtheta": 0.2569269835948944,
      "pose_mae_dx": 0.14571386575698853,
      "pose_mae_dy": 0.119662806391716,
      "pose_rmse_dtheta": 0.3933165967464447,
      "pose_rmse_dx": 0.3009681701660156,
      "pose_rmse_dy": 0.2513970136642456,
      "pose_rmse_mean": 0.3152272701263428,
      "rmse_dtheta": 0.046295084059238434,
      "rmse_dx": 0.03249727189540863,
      "rmse_dy": 0.01760965771973133,
      "rmse_mean": 0.032134003937244415,
      "rotation_flip": 0.009273570030927658,
      "sparse_tokens": 10893.0,
      "step": 8289,
      "turn_loss": 0.3612494170665741,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.3851514588366475,
      "grad_norm": 0.7636783719062805,
      "learning_rate": 2.220499975942461e-06,
      "loss": 0.1634,
      "mae_dtheta": 0.029995013028383255,
      "mae_dx": 0.010383437387645245,
      "mae_dy": 0.005258483346551657,
      "pose_mae_dtheta": 0.25476017594337463,
      "pose_mae_dx": 0.09811979532241821,
      "pose_mae_dy": 0.08018581569194794,
      "pose_rmse_dtheta": 0.44361862540245056,
      "pose_rmse_dx": 0.22384054958820343,
      "pose_rmse_dy": 0.20430728793144226,
      "pose_rmse_mean": 0.2905888259410858,
      "rmse_dtheta": 0.04734541103243828,
      "rmse_dx": 0.022495878860354424,
      "rmse_dy": 0.011357303708791733,
      "rmse_mean": 0.027066197246313095,
      "rotation_flip": 0.00522193219512701,
      "sparse_tokens": 12534.0,
      "step": 8290,
      "turn_loss": 0.23084533214569092,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.38519791860249025,
      "grad_norm": 0.7928415536880493,
      "learning_rate": 2.219400979585007e-06,
      "loss": 0.0763,
      "mae_dtheta": 0.004277700558304787,
      "mae_dx": 0.0010400032624602318,
      "mae_dy": 0.000758121837861836,
      "pose_mae_dtheta": 0.03168048709630966,
      "pose_mae_dx": 0.01001488696783781,
      "pose_mae_dy": 0.010953246615827084,
      "pose_rmse_dtheta": 0.13924536108970642,
      "pose_rmse_dx": 0.025306565687060356,
      "pose_rmse_dy": 0.03939326852560043,
      "pose_rmse_mean": 0.06798173487186432,
      "rmse_dtheta": 0.015767747536301613,
      "rmse_dx": 0.003238481702283025,
      "rmse_dy": 0.0029856336768716574,
      "rmse_mean": 0.007330621592700481,
      "rotation_flip": 0.0043196543119847775,
      "sparse_tokens": 32137.0,
      "step": 8291,
      "turn_loss": 0.03402591496706009,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.38524437836833303,
      "grad_norm": 0.8082036972045898,
      "learning_rate": 2.218302177676333e-06,
      "loss": 0.1669,
      "mae_dtheta": 0.021131910383701324,
      "mae_dx": 0.011850452050566673,
      "mae_dy": 0.011446816846728325,
      "pose_mae_dtheta": 0.16663530468940735,
      "pose_mae_dx": 0.13403664529323578,
      "pose_mae_dy": 0.053894076496362686,
      "pose_rmse_dtheta": 0.31780532002449036,
      "pose_rmse_dx": 0.25556421279907227,
      "pose_rmse_dy": 0.12386221438646317,
      "pose_rmse_mean": 0.23241057991981506,
      "rmse_dtheta": 0.04376782104372978,
      "rmse_dx": 0.022690465673804283,
      "rmse_dy": 0.02364932931959629,
      "rmse_mean": 0.030035872012376785,
      "rotation_flip": 0.01840490847826004,
      "sparse_tokens": 2547.0,
      "step": 8292,
      "turn_loss": 0.3983384966850281,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3852908381341758,
      "grad_norm": 0.7246162295341492,
      "learning_rate": 2.2172035702932828e-06,
      "loss": 0.1262,
      "mae_dtheta": 0.009816894307732582,
      "mae_dx": 0.0010296073742210865,
      "mae_dy": 0.0014731978299096227,
      "pose_mae_dtheta": 0.06657774746417999,
      "pose_mae_dx": 0.014608785510063171,
      "pose_mae_dy": 0.022530587390065193,
      "pose_rmse_dtheta": 0.19807860255241394,
      "pose_rmse_dx": 0.03358275070786476,
      "pose_rmse_dy": 0.047966573387384415,
      "pose_rmse_mean": 0.09320931136608124,
      "rmse_dtheta": 0.023643776774406433,
      "rmse_dx": 0.003587192390114069,
      "rmse_dy": 0.0026264977641403675,
      "rmse_mean": 0.009952489286661148,
      "rotation_flip": 0.0030120480805635452,
      "sparse_tokens": 32089.0,
      "step": 8293,
      "turn_loss": 0.07109075784683228,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.3853372979000186,
      "grad_norm": 0.5679998993873596,
      "learning_rate": 2.2161051575126784e-06,
      "loss": 0.188,
      "mae_dtheta": 0.037414565682411194,
      "mae_dx": 0.008461820892989635,
      "mae_dy": 0.0071967411786317825,
      "pose_mae_dtheta": 0.30506768822669983,
      "pose_mae_dx": 0.09036835283041,
      "pose_mae_dy": 0.0672076866030693,
      "pose_rmse_dtheta": 0.5916187763214111,
      "pose_rmse_dx": 0.2191176414489746,
      "pose_rmse_dy": 0.1682007610797882,
      "pose_rmse_mean": 0.326312392950058,
      "rmse_dtheta": 0.060765497386455536,
      "rmse_dx": 0.019161801785230637,
      "rmse_dy": 0.01706867292523384,
      "rmse_mean": 0.03233198821544647,
      "rotation_flip": 0.005025125574320555,
      "sparse_tokens": 15860.0,
      "step": 8294,
      "turn_loss": 0.2915459871292114,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.38538375766586136,
      "grad_norm": 0.4357805848121643,
      "learning_rate": 2.2150069394113364e-06,
      "loss": 0.1155,
      "mae_dtheta": 0.008620090782642365,
      "mae_dx": 0.0017991734202951193,
      "mae_dy": 0.0019486865494400263,
      "pose_mae_dtheta": 0.06413730978965759,
      "pose_mae_dx": 0.017716944217681885,
      "pose_mae_dy": 0.01858159713447094,
      "pose_rmse_dtheta": 0.19036535918712616,
      "pose_rmse_dx": 0.05311354249715805,
      "pose_rmse_dy": 0.04247663542628288,
      "pose_rmse_mean": 0.0953185111284256,
      "rmse_dtheta": 0.02249419130384922,
      "rmse_dx": 0.005814427509903908,
      "rmse_dy": 0.005756331142038107,
      "rmse_mean": 0.011354982852935791,
      "rotation_flip": 0.00551314651966095,
      "sparse_tokens": 32105.0,
      "step": 8295,
      "turn_loss": 0.07491535693407059,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.38543021743170414,
      "grad_norm": 0.8051032423973083,
      "learning_rate": 2.213908916066052e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.03369013965129852,
      "mae_dx": 0.005267881788313389,
      "mae_dy": 0.007985776290297508,
      "pose_mae_dtheta": 0.311262845993042,
      "pose_mae_dx": 0.04419035464525223,
      "pose_mae_dy": 0.16680112481117249,
      "pose_rmse_dtheta": 0.5259778499603271,
      "pose_rmse_dx": 0.09787672758102417,
      "pose_rmse_dy": 0.3231268525123596,
      "pose_rmse_mean": 0.3156604766845703,
      "rmse_dtheta": 0.04644612595438957,
      "rmse_dx": 0.015351668931543827,
      "rmse_dy": 0.011451086029410362,
      "rmse_mean": 0.02441629394888878,
      "rotation_flip": 0.01785714365541935,
      "sparse_tokens": 2701.0,
      "step": 8296,
      "turn_loss": 0.2123294621706009,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.3854766771975469,
      "grad_norm": 0.5234097242355347,
      "learning_rate": 2.2128110875536147e-06,
      "loss": 0.1724,
      "mae_dtheta": 0.03395800665020943,
      "mae_dx": 0.009762587025761604,
      "mae_dy": 0.0038925078697502613,
      "pose_mae_dtheta": 0.2606964409351349,
      "pose_mae_dx": 0.0766248032450676,
      "pose_mae_dy": 0.03774568438529968,
      "pose_rmse_dtheta": 0.4846820831298828,
      "pose_rmse_dx": 0.1617097705602646,
      "pose_rmse_dy": 0.09958174079656601,
      "pose_rmse_mean": 0.24865786731243134,
      "rmse_dtheta": 0.05419853702187538,
      "rmse_dx": 0.01993635483086109,
      "rmse_dy": 0.008475029841065407,
      "rmse_mean": 0.02753664180636406,
      "rotation_flip": 0.009285051375627518,
      "sparse_tokens": 18573.0,
      "step": 8297,
      "turn_loss": 0.26676955819129944,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3855231369633897,
      "grad_norm": 0.5323972105979919,
      "learning_rate": 2.2117134539507923e-06,
      "loss": 0.1167,
      "mae_dtheta": 0.009684381075203419,
      "mae_dx": 0.0019117870833724737,
      "mae_dy": 0.002509511075913906,
      "pose_mae_dtheta": 0.06668281555175781,
      "pose_mae_dx": 0.0239938385784626,
      "pose_mae_dy": 0.030534328892827034,
      "pose_rmse_dtheta": 0.1622675359249115,
      "pose_rmse_dx": 0.058437954634428024,
      "pose_rmse_dy": 0.06768427044153214,
      "pose_rmse_mean": 0.09612992405891418,
      "rmse_dtheta": 0.019543269649147987,
      "rmse_dx": 0.006360528524965048,
      "rmse_dy": 0.005157385487109423,
      "rmse_mean": 0.01035372819751501,
      "rotation_flip": 0.0039285714738070965,
      "sparse_tokens": 32089.0,
      "step": 8298,
      "turn_loss": 0.08246512711048126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.38556959672923247,
      "grad_norm": 0.604324221611023,
      "learning_rate": 2.210616015334344e-06,
      "loss": 0.1508,
      "mae_dtheta": 0.011461499147117138,
      "mae_dx": 0.0020382332149893045,
      "mae_dy": 0.003458845429122448,
      "pose_mae_dtheta": 0.07064776867628098,
      "pose_mae_dx": 0.029260938987135887,
      "pose_mae_dy": 0.03491232544183731,
      "pose_rmse_dtheta": 0.14607933163642883,
      "pose_rmse_dx": 0.06981290131807327,
      "pose_rmse_dy": 0.07265768945217133,
      "pose_rmse_mean": 0.09618330001831055,
      "rmse_dtheta": 0.02173394151031971,
      "rmse_dx": 0.0047590238973498344,
      "rmse_dy": 0.006903910543769598,
      "rmse_mean": 0.01113229151815176,
      "rotation_flip": 0.007570770103484392,
      "sparse_tokens": 32121.0,
      "step": 8299,
      "turn_loss": 0.11029607802629471,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.38561605649507524,
      "grad_norm": 1.0131139755249023,
      "learning_rate": 2.2095187717810175e-06,
      "loss": 0.2162,
      "mae_dtheta": 0.03740821033716202,
      "mae_dx": 0.00989550445228815,
      "mae_dy": 0.004872790537774563,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999988675117493,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 145.1903839111328,
      "model/head/act_norm_mean": 109.06273251488095,
      "model/head/act_norm_min": 80.8883056640625,
      "model/head/act_over_embed": 74.94893084561508,
      "model/head/grad_frac": 0.12023177742958069,
      "model/head/grad_norm": 0.12023164331912994,
      "model/head/grad_zero_frac": 0.00014245502825360745,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6982886904761905,
      "model/head/update_ratio": 0.0020481685642153025,
      "model/head/weight_delta": 9.74319839477539,
      "model/head/weight_delta_rel": 0.17092455923557281,
      "model/head/weight_norm": 58.7020263671875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42224594950675964,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42224594950675964,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42224594950675964,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901713696299071,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12882301211357117,
      "model/modality_embedder.encoders.pose/grad_norm": 0.12882286310195923,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.004160031676292419,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1098580360412598,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1016087532043457,
      "model/modality_embedder.encoders.pose/weight_norm": 30.966796875,
      "model/modality_embedder/grad_frac": 0.12882301211357117,
      "model/modality_embedder/grad_norm": 0.12882286310195923,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.004160031676292419,
      "model/modality_embedder/weight_delta": 3.1098580360412598,
      "model/modality_embedder/weight_delta_rel": 0.1016087532043457,
      "model/modality_embedder/weight_norm": 30.966796875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.09130859375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.525629783163264,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.196246147155762,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.167033037405925,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09596077352762222,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.09596066176891327,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.003435221966356039,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6219253540039062,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09554453939199448,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.934341430664062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 85.46221160888672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.319268766534393,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.683411598205566,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.712429176943793,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08796630054712296,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0879662036895752,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002959106583148241,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3244125843048096,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1151602491736412,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.727283477783203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.79225158691406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.9286541005291,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.57484245300293,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.818413845767843,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07679874449968338,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07679865509271622,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0025019412860274315,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.595288038253784,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12072303891181946,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.69562530517578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.37831115722656,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.782501889644745,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.194080352783203,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.092395402444563,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06909753382205963,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06909745186567307,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002309412695467472,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.082686185836792,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10535158216953278,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.919923782348633,
      "model/normalizer/grad_frac": 0.2954496741294861,
      "model/normalizer/grad_norm": 0.2954493463039398,
      "model/normalizer/grad_zero_frac": 0.00016662511916365474,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0037584586534649134,
      "model/normalizer/weight_delta": 6.500392436981201,
      "model/normalizer/weight_delta_rel": 0.08372128754854202,
      "model/normalizer/weight_norm": 78.60917663574219,
      "pose_mae_dtheta": 0.3271555006504059,
      "pose_mae_dx": 0.0803634524345398,
      "pose_mae_dy": 0.07892170548439026,
      "pose_rmse_dtheta": 0.5704611539840698,
      "pose_rmse_dx": 0.19151534140110016,
      "pose_rmse_dy": 0.21684132516384125,
      "pose_rmse_mean": 0.3262726068496704,
      "rmse_dtheta": 0.05649411305785179,
      "rmse_dx": 0.022594323381781578,
      "rmse_dy": 0.009991209022700787,
      "rmse_mean": 0.02969321422278881,
      "rotation_flip": 0.010638297535479069,
      "sparse_tokens": 23102.0,
      "step": 8300,
      "turn_loss": 0.2826445996761322,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 23045.0,
      "epoch": 0.385662516260918,
      "grad_norm": 0.6436694264411926,
      "learning_rate": 2.2084217233675386e-06,
      "loss": 0.185,
      "mae_dtheta": 0.03417345881462097,
      "mae_dx": 0.009894543327391148,
      "mae_dy": 0.008552275598049164,
      "pose_mae_dtheta": 0.24188227951526642,
      "pose_mae_dx": 0.06501547247171402,
      "pose_mae_dy": 0.08825474977493286,
      "pose_rmse_dtheta": 0.4877818822860718,
      "pose_rmse_dx": 0.16798032820224762,
      "pose_rmse_dy": 0.23554301261901855,
      "pose_rmse_mean": 0.2971017360687256,
      "rmse_dtheta": 0.05530232563614845,
      "rmse_dx": 0.021871861070394516,
      "rmse_dy": 0.02053840272128582,
      "rmse_mean": 0.032570865005254745,
      "rotation_flip": 0.011398963630199432,
      "sparse_tokens": 18572.0,
      "step": 8301,
      "turn_loss": 0.3472362458705902,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.38570897602676085,
      "grad_norm": 0.6337307095527649,
      "learning_rate": 2.207324870170629e-06,
      "loss": 0.0919,
      "mae_dtheta": 0.008851904422044754,
      "mae_dx": 0.0013158217770978808,
      "mae_dy": 0.002283687936142087,
      "pose_mae_dtheta": 0.05842319875955582,
      "pose_mae_dx": 0.01936560496687889,
      "pose_mae_dy": 0.023366324603557587,
      "pose_rmse_dtheta": 0.150249183177948,
      "pose_rmse_dx": 0.05671738088130951,
      "pose_rmse_dy": 0.06058114767074585,
      "pose_rmse_mean": 0.08918257802724838,
      "rmse_dtheta": 0.019535133615136147,
      "rmse_dx": 0.0039609577506780624,
      "rmse_dy": 0.005200600251555443,
      "rmse_mean": 0.00956556387245655,
      "rotation_flip": 0.006291635800153017,
      "sparse_tokens": 32089.0,
      "step": 8302,
      "turn_loss": 0.07010461390018463,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.38575543579260363,
      "grad_norm": 0.44070082902908325,
      "learning_rate": 2.206228212266988e-06,
      "loss": 0.1067,
      "mae_dtheta": 0.03317631036043167,
      "mae_dx": 0.009264456108212471,
      "mae_dy": 0.002283317968249321,
      "pose_mae_dtheta": 0.27109774947166443,
      "pose_mae_dx": 0.07933390140533447,
      "pose_mae_dy": 0.017381224781274796,
      "pose_rmse_dtheta": 0.4902816712856293,
      "pose_rmse_dx": 0.19412130117416382,
      "pose_rmse_dy": 0.053378649055957794,
      "pose_rmse_mean": 0.24592719972133636,
      "rmse_dtheta": 0.05388488247990608,
      "rmse_dx": 0.02104094624519348,
      "rmse_dy": 0.006878549698740244,
      "rmse_mean": 0.027268124744296074,
      "rotation_flip": 0.009316770359873772,
      "sparse_tokens": 11048.0,
      "step": 8303,
      "turn_loss": 0.24198274314403534,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3858018955584464,
      "grad_norm": 0.40564975142478943,
      "learning_rate": 2.2051317497333096e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.010045559145510197,
      "mae_dx": 0.002152542117983103,
      "mae_dy": 0.003417820204049349,
      "pose_mae_dtheta": 0.06490106880664825,
      "pose_mae_dx": 0.020169926807284355,
      "pose_mae_dy": 0.029604721814393997,
      "pose_rmse_dtheta": 0.138229638338089,
      "pose_rmse_dx": 0.04808497801423073,
      "pose_rmse_dy": 0.071720190346241,
      "pose_rmse_mean": 0.086011603474617,
      "rmse_dtheta": 0.020861241966485977,
      "rmse_dx": 0.0059312619268894196,
      "rmse_dy": 0.008414991199970245,
      "rmse_mean": 0.011735832318663597,
      "rotation_flip": 0.005092761013656855,
      "sparse_tokens": 32089.0,
      "step": 8304,
      "turn_loss": 0.10866288095712662,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3858483553242892,
      "grad_norm": 0.49046704173088074,
      "learning_rate": 2.204035482646267e-06,
      "loss": 0.095,
      "mae_dtheta": 0.009301175363361835,
      "mae_dx": 0.0023250621743500233,
      "mae_dy": 0.002241613809019327,
      "pose_mae_dtheta": 0.06146826595067978,
      "pose_mae_dx": 0.024460403248667717,
      "pose_mae_dy": 0.02433853968977928,
      "pose_rmse_dtheta": 0.1742154210805893,
      "pose_rmse_dx": 0.0715608298778534,
      "pose_rmse_dy": 0.072284035384655,
      "pose_rmse_mean": 0.10602009296417236,
      "rmse_dtheta": 0.02183520421385765,
      "rmse_dx": 0.007862704806029797,
      "rmse_dy": 0.005723029375076294,
      "rmse_mean": 0.011806979775428772,
      "rotation_flip": 0.006896551698446274,
      "sparse_tokens": 32089.0,
      "step": 8305,
      "turn_loss": 0.07726846635341644,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20129.0,
      "epoch": 0.38589481509013196,
      "grad_norm": 0.6737611889839172,
      "learning_rate": 2.2029394110825226e-06,
      "loss": 0.1585,
      "mae_dtheta": 0.036238931119441986,
      "mae_dx": 0.012134838849306107,
      "mae_dy": 0.00673729507252574,
      "pose_mae_dtheta": 0.26009267568588257,
      "pose_mae_dx": 0.08823121339082718,
      "pose_mae_dy": 0.09624814242124557,
      "pose_rmse_dtheta": 0.43898600339889526,
      "pose_rmse_dx": 0.19313640892505646,
      "pose_rmse_dy": 0.2262975424528122,
      "pose_rmse_mean": 0.28613999485969543,
      "rmse_dtheta": 0.053928833454847336,
      "rmse_dx": 0.023853139951825142,
      "rmse_dy": 0.012547679245471954,
      "rmse_mean": 0.030109886080026627,
      "rotation_flip": 0.010663507506251335,
      "sparse_tokens": 16617.0,
      "step": 8306,
      "turn_loss": 0.30805715918540955,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.38594127485597474,
      "grad_norm": 0.3519779145717621,
      "learning_rate": 2.201843535118729e-06,
      "loss": 0.0786,
      "mae_dtheta": 0.010008900426328182,
      "mae_dx": 0.0013376777060329914,
      "mae_dy": 0.0026531703770160675,
      "pose_mae_dtheta": 0.06463506817817688,
      "pose_mae_dx": 0.022327542304992676,
      "pose_mae_dy": 0.031407225877046585,
      "pose_rmse_dtheta": 0.16838760673999786,
      "pose_rmse_dx": 0.05827764794230461,
      "pose_rmse_dy": 0.07278703153133392,
      "pose_rmse_mean": 0.0998174399137497,
      "rmse_dtheta": 0.0219111330807209,
      "rmse_dx": 0.0038346126675605774,
      "rmse_dy": 0.0055955760180950165,
      "rmse_mean": 0.010447107255458832,
      "rotation_flip": 0.003759398590773344,
      "sparse_tokens": 32041.0,
      "step": 8307,
      "turn_loss": 0.0818735882639885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.3859877346218175,
      "grad_norm": 0.9907507300376892,
      "learning_rate": 2.200747854831517e-06,
      "loss": 0.2516,
      "mae_dtheta": 0.038304299116134644,
      "mae_dx": 0.007403645198792219,
      "mae_dy": 0.002888159826397896,
      "pose_mae_dtheta": 0.28248676657676697,
      "pose_mae_dx": 0.055528122931718826,
      "pose_mae_dy": 0.03013600781559944,
      "pose_rmse_dtheta": 0.5348866581916809,
      "pose_rmse_dx": 0.14320574700832367,
      "pose_rmse_dy": 0.08605905622243881,
      "pose_rmse_mean": 0.2547171711921692,
      "rmse_dtheta": 0.06044195964932442,
      "rmse_dx": 0.016760706901550293,
      "rmse_dy": 0.0071677276864647865,
      "rmse_mean": 0.028123464435338974,
      "rotation_flip": 0.012195121496915817,
      "sparse_tokens": 11386.0,
      "step": 8308,
      "turn_loss": 0.24520057439804077,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3860341943876603,
      "grad_norm": 0.3966614902019501,
      "learning_rate": 2.1996523702975115e-06,
      "loss": 0.0985,
      "mae_dtheta": 0.006171283777803183,
      "mae_dx": 0.0010990106966346502,
      "mae_dy": 0.0012959850719198585,
      "pose_mae_dtheta": 0.04299401864409447,
      "pose_mae_dx": 0.009703699499368668,
      "pose_mae_dy": 0.015457564033567905,
      "pose_rmse_dtheta": 0.10961844772100449,
      "pose_rmse_dx": 0.023364044725894928,
      "pose_rmse_dy": 0.03657066076993942,
      "pose_rmse_mean": 0.056517720222473145,
      "rmse_dtheta": 0.015672607347369194,
      "rmse_dx": 0.003397610504180193,
      "rmse_dy": 0.003447555238381028,
      "rmse_mean": 0.007505924440920353,
      "rotation_flip": 0.0025488529354333878,
      "sparse_tokens": 32153.0,
      "step": 8309,
      "turn_loss": 0.04475519433617592,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.38608065415350307,
      "grad_norm": 0.6428325176239014,
      "learning_rate": 2.198557081593317e-06,
      "loss": 0.1188,
      "mae_dtheta": 0.01003965362906456,
      "mae_dx": 0.0019562426023185253,
      "mae_dy": 0.0026745039504021406,
      "pose_mae_dtheta": 0.07543131709098816,
      "pose_mae_dx": 0.021177297458052635,
      "pose_mae_dy": 0.026501387357711792,
      "pose_rmse_dtheta": 0.22421805560588837,
      "pose_rmse_dx": 0.066281758248806,
      "pose_rmse_dy": 0.0638776570558548,
      "pose_rmse_mean": 0.11812581866979599,
      "rmse_dtheta": 0.024704059585928917,
      "rmse_dx": 0.006323474459350109,
      "rmse_dy": 0.007504472509026527,
      "rmse_mean": 0.01284400187432766,
      "rotation_flip": 0.004836759530007839,
      "sparse_tokens": 32089.0,
      "step": 8310,
      "turn_loss": 0.0989358127117157,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.38612711391934584,
      "grad_norm": 0.594395637512207,
      "learning_rate": 2.1974619887955294e-06,
      "loss": 0.1428,
      "mae_dtheta": 0.033985208719968796,
      "mae_dx": 0.01805245317518711,
      "mae_dy": 0.0092904232442379,
      "pose_mae_dtheta": 0.28691694140434265,
      "pose_mae_dx": 0.12344161421060562,
      "pose_mae_dy": 0.08328785747289658,
      "pose_rmse_dtheta": 0.4440097212791443,
      "pose_rmse_dx": 0.2824394404888153,
      "pose_rmse_dy": 0.21592330932617188,
      "pose_rmse_mean": 0.3141241669654846,
      "rmse_dtheta": 0.04844341427087784,
      "rmse_dx": 0.03162245824933052,
      "rmse_dy": 0.019712457433342934,
      "rmse_mean": 0.03325944393873215,
      "rotation_flip": 0.01034482754766941,
      "sparse_tokens": 5144.0,
      "step": 8311,
      "turn_loss": 0.3098936975002289,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3861735736851886,
      "grad_norm": 0.4822187125682831,
      "learning_rate": 2.196367091980731e-06,
      "loss": 0.1033,
      "mae_dtheta": 0.00905581098049879,
      "mae_dx": 0.0011128269834443927,
      "mae_dy": 0.0015772487968206406,
      "pose_mae_dtheta": 0.05920731648802757,
      "pose_mae_dx": 0.013612257316708565,
      "pose_mae_dy": 0.020002108067274094,
      "pose_rmse_dtheta": 0.19634748995304108,
      "pose_rmse_dx": 0.03210136666893959,
      "pose_rmse_dy": 0.042629487812519073,
      "pose_rmse_mean": 0.09035944938659668,
      "rmse_dtheta": 0.022135747596621513,
      "rmse_dx": 0.0031486244406551123,
      "rmse_dy": 0.003153184661641717,
      "rmse_mean": 0.009479185566306114,
      "rotation_flip": 0.003008649917319417,
      "sparse_tokens": 32121.0,
      "step": 8312,
      "turn_loss": 0.06430918723344803,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3862200334510314,
      "grad_norm": 0.4863850474357605,
      "learning_rate": 2.195272391225485e-06,
      "loss": 0.0854,
      "mae_dtheta": 0.007757891435176134,
      "mae_dx": 0.0013032343704253435,
      "mae_dy": 0.0020568277686834335,
      "pose_mae_dtheta": 0.052923183888196945,
      "pose_mae_dx": 0.0180282574146986,
      "pose_mae_dy": 0.02292679250240326,
      "pose_rmse_dtheta": 0.108365498483181,
      "pose_rmse_dx": 0.04315560683608055,
      "pose_rmse_dy": 0.054916974157094955,
      "pose_rmse_mean": 0.06881269812583923,
      "rmse_dtheta": 0.017521118745207787,
      "rmse_dx": 0.0037429900839924812,
      "rmse_dy": 0.004538806155323982,
      "rmse_mean": 0.008600972592830658,
      "rotation_flip": 0.006085192784667015,
      "sparse_tokens": 32073.0,
      "step": 8313,
      "turn_loss": 0.0718206837773323,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 42706.0,
      "epoch": 0.3862664932168742,
      "grad_norm": 0.41103461384773254,
      "learning_rate": 2.194177886606348e-06,
      "loss": 0.152,
      "mae_dtheta": 0.050634223967790604,
      "mae_dx": 0.010323494672775269,
      "mae_dy": 0.004816596396267414,
      "pose_mae_dtheta": 0.428030788898468,
      "pose_mae_dx": 0.09000837802886963,
      "pose_mae_dy": 0.046638887375593185,
      "pose_rmse_dtheta": 0.6773200631141663,
      "pose_rmse_dx": 0.1875385344028473,
      "pose_rmse_dy": 0.1249772235751152,
      "pose_rmse_mean": 0.32994529604911804,
      "rmse_dtheta": 0.07015102356672287,
      "rmse_dx": 0.02069113962352276,
      "rmse_dy": 0.01270882785320282,
      "rmse_mean": 0.03451699763536453,
      "rotation_flip": 0.021690012887120247,
      "sparse_tokens": 30106.0,
      "step": 8314,
      "turn_loss": 0.36337366700172424,
      "turns": 132.0,
      "turns_per_sample": 132.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.38631295298271695,
      "grad_norm": 0.6355941891670227,
      "learning_rate": 2.193083578199855e-06,
      "loss": 0.1483,
      "mae_dtheta": 0.016027463600039482,
      "mae_dx": 0.012752375565469265,
      "mae_dy": 0.0021467464976012707,
      "pose_mae_dtheta": 0.12209532409906387,
      "pose_mae_dx": 0.11580338329076767,
      "pose_mae_dy": 0.03396964073181152,
      "pose_rmse_dtheta": 0.2615394592285156,
      "pose_rmse_dx": 0.3036384582519531,
      "pose_rmse_dy": 0.08980745077133179,
      "pose_rmse_mean": 0.21832846105098724,
      "rmse_dtheta": 0.031149068847298622,
      "rmse_dx": 0.029074447229504585,
      "rmse_dy": 0.00471179885789752,
      "rmse_mean": 0.02164510451257229,
      "rotation_flip": 0.010619468986988068,
      "sparse_tokens": 15676.0,
      "step": 8315,
      "turn_loss": 0.14240141212940216,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3863594127485597,
      "grad_norm": 0.6371548771858215,
      "learning_rate": 2.1919894660825362e-06,
      "loss": 0.0846,
      "mae_dtheta": 0.007315515074878931,
      "mae_dx": 0.0015816426603123546,
      "mae_dy": 0.0015023110900074244,
      "pose_mae_dtheta": 0.04937468841671944,
      "pose_mae_dx": 0.01627681776881218,
      "pose_mae_dy": 0.017124470323324203,
      "pose_rmse_dtheta": 0.1379086673259735,
      "pose_rmse_dx": 0.04582692310214043,
      "pose_rmse_dy": 0.04194102808833122,
      "pose_rmse_mean": 0.07522554695606232,
      "rmse_dtheta": 0.018036505207419395,
      "rmse_dx": 0.005443008616566658,
      "rmse_dy": 0.0038379149045795202,
      "rmse_mean": 0.009105809964239597,
      "rotation_flip": 0.002258355962112546,
      "sparse_tokens": 32137.0,
      "step": 8316,
      "turn_loss": 0.061345383524894714,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.3864058725144025,
      "grad_norm": 0.7242802977561951,
      "learning_rate": 2.190895550330899e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.03969726338982582,
      "mae_dx": 0.017416849732398987,
      "mae_dy": 0.010764777660369873,
      "pose_mae_dtheta": 0.30513426661491394,
      "pose_mae_dx": 0.16204355657100677,
      "pose_mae_dy": 0.12696591019630432,
      "pose_rmse_dtheta": 0.5178887844085693,
      "pose_rmse_dx": 0.32356929779052734,
      "pose_rmse_dy": 0.24772578477859497,
      "pose_rmse_mean": 0.3630612790584564,
      "rmse_dtheta": 0.05982660874724388,
      "rmse_dx": 0.03228214383125305,
      "rmse_dy": 0.021993538364768028,
      "rmse_mean": 0.0380341000854969,
      "rotation_flip": 0.011709601618349552,
      "sparse_tokens": 7360.0,
      "step": 8317,
      "turn_loss": 0.4617229104042053,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3864523322802453,
      "grad_norm": 0.6430800557136536,
      "learning_rate": 2.189801831021444e-06,
      "loss": 0.1851,
      "mae_dtheta": 0.014362704008817673,
      "mae_dx": 0.003413331462070346,
      "mae_dy": 0.004683570470660925,
      "pose_mae_dtheta": 0.10851337760686874,
      "pose_mae_dx": 0.03695162013173103,
      "pose_mae_dy": 0.03819475322961807,
      "pose_rmse_dtheta": 0.28840726613998413,
      "pose_rmse_dx": 0.10897091031074524,
      "pose_rmse_dy": 0.09277649223804474,
      "pose_rmse_mean": 0.16338489949703217,
      "rmse_dtheta": 0.031420107930898666,
      "rmse_dx": 0.011286180466413498,
      "rmse_dy": 0.01277090422809124,
      "rmse_mean": 0.018492398783564568,
      "rotation_flip": 0.003225806402042508,
      "sparse_tokens": 32057.0,
      "step": 8318,
      "turn_loss": 0.15164630115032196,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.3864987920460881,
      "grad_norm": 0.5746660232543945,
      "learning_rate": 2.1887083082306576e-06,
      "loss": 0.1517,
      "mae_dtheta": 0.051270272582769394,
      "mae_dx": 0.01729561574757099,
      "mae_dy": 0.01116421353071928,
      "pose_mae_dtheta": 0.40088778734207153,
      "pose_mae_dx": 0.1684217005968094,
      "pose_mae_dy": 0.10276917368173599,
      "pose_rmse_dtheta": 0.654270350933075,
      "pose_rmse_dx": 0.34831470251083374,
      "pose_rmse_dy": 0.2029898315668106,
      "pose_rmse_mean": 0.40185829997062683,
      "rmse_dtheta": 0.06982921063899994,
      "rmse_dx": 0.030776556581258774,
      "rmse_dy": 0.021196361631155014,
      "rmse_mean": 0.04060071334242821,
      "rotation_flip": 0.013170273043215275,
      "sparse_tokens": 18734.0,
      "step": 8319,
      "turn_loss": 0.45601192116737366,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.3865452518119309,
      "grad_norm": 0.721998929977417,
      "learning_rate": 2.1876149820350057e-06,
      "loss": 0.1518,
      "mae_dtheta": 0.03159305080771446,
      "mae_dx": 0.007691499777138233,
      "mae_dy": 0.00347462622448802,
      "pose_mae_dtheta": 0.24646051228046417,
      "pose_mae_dx": 0.06767904758453369,
      "pose_mae_dy": 0.042312055826187134,
      "pose_rmse_dtheta": 0.47549840807914734,
      "pose_rmse_dx": 0.17134742438793182,
      "pose_rmse_dy": 0.09325015544891357,
      "pose_rmse_mean": 0.24669866263866425,
      "rmse_dtheta": 0.052479423582553864,
      "rmse_dx": 0.019139358773827553,
      "rmse_dy": 0.007146055810153484,
      "rmse_mean": 0.026254944503307343,
      "rotation_flip": 0.007957560010254383,
      "sparse_tokens": 13863.0,
      "step": 8320,
      "turn_loss": 0.23013536632061005,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.38659171157777367,
      "grad_norm": 0.44003817439079285,
      "learning_rate": 2.1865218525109496e-06,
      "loss": 0.0965,
      "mae_dtheta": 0.0073340716771781445,
      "mae_dx": 0.0015218607150018215,
      "mae_dy": 0.00024533853866159916,
      "pose_mae_dtheta": 0.049785252660512924,
      "pose_mae_dx": 0.011511113494634628,
      "pose_mae_dy": 0.00315762497484684,
      "pose_rmse_dtheta": 0.20760470628738403,
      "pose_rmse_dx": 0.026206303387880325,
      "pose_rmse_dy": 0.0062074000015854836,
      "pose_rmse_mean": 0.08000613749027252,
      "rmse_dtheta": 0.027284963056445122,
      "rmse_dx": 0.004120329394936562,
      "rmse_dy": 0.0005841308156959713,
      "rmse_mean": 0.010663140565156937,
      "rotation_flip": 0.001636661239899695,
      "sparse_tokens": 32249.0,
      "step": 8321,
      "turn_loss": 0.04307273030281067,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.38663817134361644,
      "grad_norm": 0.5685813426971436,
      "learning_rate": 2.1854289197349284e-06,
      "loss": 0.1375,
      "mae_dtheta": 0.0058827269822359085,
      "mae_dx": 0.0009620192577131093,
      "mae_dy": 0.0007435841835103929,
      "pose_mae_dtheta": 0.03923172503709793,
      "pose_mae_dx": 0.008128560148179531,
      "pose_mae_dy": 0.00918601918965578,
      "pose_rmse_dtheta": 0.15782201290130615,
      "pose_rmse_dx": 0.018400566652417183,
      "pose_rmse_dy": 0.02206982485949993,
      "pose_rmse_mean": 0.06609746813774109,
      "rmse_dtheta": 0.019708681851625443,
      "rmse_dx": 0.0027473473455756903,
      "rmse_dy": 0.001892932690680027,
      "rmse_mean": 0.008116321638226509,
      "rotation_flip": 0.0013850415125489235,
      "sparse_tokens": 32169.0,
      "step": 8322,
      "turn_loss": 0.04410179331898689,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.3866846311094592,
      "grad_norm": 0.749840497970581,
      "learning_rate": 2.1843361837833755e-06,
      "loss": 0.2683,
      "mae_dtheta": 0.03835354372859001,
      "mae_dx": 0.01030751597136259,
      "mae_dy": 0.007266190368682146,
      "pose_mae_dtheta": 0.29567137360572815,
      "pose_mae_dx": 0.08381208032369614,
      "pose_mae_dy": 0.06784389913082123,
      "pose_rmse_dtheta": 0.5187650322914124,
      "pose_rmse_dx": 0.19243599474430084,
      "pose_rmse_dy": 0.15311633050441742,
      "pose_rmse_mean": 0.2881057858467102,
      "rmse_dtheta": 0.05741254985332489,
      "rmse_dx": 0.02160787209868431,
      "rmse_dy": 0.015539051033556461,
      "rmse_mean": 0.031519826501607895,
      "rotation_flip": 0.013084111735224724,
      "sparse_tokens": 16458.0,
      "step": 8323,
      "turn_loss": 0.3124161660671234,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.386731090875302,
      "grad_norm": 0.5219801664352417,
      "learning_rate": 2.1832436447327026e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.013619035482406616,
      "mae_dx": 0.0031495876610279083,
      "mae_dy": 0.004372735507786274,
      "pose_mae_dtheta": 0.09320390969514847,
      "pose_mae_dx": 0.042687930166721344,
      "pose_mae_dy": 0.03802891820669174,
      "pose_rmse_dtheta": 0.23554976284503937,
      "pose_rmse_dx": 0.1116701140999794,
      "pose_rmse_dy": 0.09005822986364365,
      "pose_rmse_mean": 0.14575937390327454,
      "rmse_dtheta": 0.028399009257555008,
      "rmse_dx": 0.00842441525310278,
      "rmse_dy": 0.008848903700709343,
      "rmse_mean": 0.015224109403789043,
      "rotation_flip": 0.005662891548126936,
      "sparse_tokens": 32089.0,
      "step": 8324,
      "turn_loss": 0.11627499759197235,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.3867775506411448,
      "grad_norm": 0.6534783840179443,
      "learning_rate": 2.1821513026593154e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.031987518072128296,
      "mae_dx": 0.008171308785676956,
      "mae_dy": 0.004194952547550201,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6534783840179443,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 148.1595916748047,
      "model/head/act_norm_mean": 108.844169921875,
      "model/head/act_norm_min": 68.79410552978516,
      "model/head/act_over_embed": 74.79873258548615,
      "model/head/grad_frac": 0.07426940649747849,
      "model/head/grad_norm": 0.048533450812101364,
      "model/head/grad_zero_frac": 0.00015641498612239957,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6998046875,
      "model/head/update_ratio": 0.0008267572848126292,
      "model/head/weight_delta": 9.749831199645996,
      "model/head/weight_delta_rel": 0.17104092240333557,
      "model/head/weight_norm": 58.70338439941406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223228693008423,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42227866099430966,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4222133159637451,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901938492704012,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09386321902275085,
      "model/modality_embedder.encoders.pose/grad_norm": 0.061337586492300034,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5333533653846154,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019807612989097834,
      "model/modality_embedder.encoders.pose/weight_delta": 3.110760450363159,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10163824260234833,
      "model/modality_embedder.encoders.pose/weight_norm": 30.966672897338867,
      "model/modality_embedder/grad_frac": 0.09386321902275085,
      "model/modality_embedder/grad_norm": 0.061337586492300034,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5333533653846154,
      "model/modality_embedder/update_ratio": 0.0019807612989097834,
      "model/modality_embedder/weight_delta": 3.110760450363159,
      "model/modality_embedder/weight_delta_rel": 0.10163824260234833,
      "model/modality_embedder/weight_norm": 30.966672897338867,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.29249572753906,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.50923611111111,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.311649322509766,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.155767152491713,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.04399622604250908,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02875058352947235,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010292050428688526,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6243104934692383,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09563145786523819,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.93474769592285,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.18911743164062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.322894345238094,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.75759506225586,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.71492070857218,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.042967088520526886,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02807806245982647,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009444853058084846,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3278229236602783,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11527838557958603,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.72842788696289,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.09394073486328,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.90921875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.02574348449707,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.805057690927626,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.04285716265439987,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.028006229549646378,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009123499621637166,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.598736524581909,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12083883583545685,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.696805953979492,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.6825942993164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.752018849206348,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.926785469055176,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.071447171668577,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.04779214411973953,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03123113326728344,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001043800264596939,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.085559129714966,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10544976592063904,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.920602798461914,
      "model/normalizer/grad_frac": 0.1751798838376999,
      "model/normalizer/grad_norm": 0.1144762635231018,
      "model/normalizer/grad_zero_frac": 0.00016307989426422864,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014562516007572412,
      "model/normalizer/weight_delta": 6.5066237449646,
      "model/normalizer/weight_delta_rel": 0.08380154520273209,
      "model/normalizer/weight_norm": 78.61022186279297,
      "pose_mae_dtheta": 0.23885121941566467,
      "pose_mae_dx": 0.06533502042293549,
      "pose_mae_dy": 0.06852841377258301,
      "pose_rmse_dtheta": 0.45179739594459534,
      "pose_rmse_dx": 0.1665605902671814,
      "pose_rmse_dy": 0.14993995428085327,
      "pose_rmse_mean": 0.2560993432998657,
      "rmse_dtheta": 0.0510411411523819,
      "rmse_dx": 0.019719736650586128,
      "rmse_dy": 0.00834579300135374,
      "rmse_mean": 0.026368889957666397,
      "rotation_flip": 0.013513513840734959,
      "sparse_tokens": 6309.0,
      "step": 8325,
      "turn_loss": 0.20300205051898956,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.38682401040698755,
      "grad_norm": 0.6300877332687378,
      "learning_rate": 2.1810591576395985e-06,
      "loss": 0.1612,
      "mae_dtheta": 0.03287944942712784,
      "mae_dx": 0.01052792463451624,
      "mae_dy": 0.005626237019896507,
      "pose_mae_dtheta": 0.2445085048675537,
      "pose_mae_dx": 0.08760218322277069,
      "pose_mae_dy": 0.06593865156173706,
      "pose_rmse_dtheta": 0.4401324391365051,
      "pose_rmse_dx": 0.19642165303230286,
      "pose_rmse_dy": 0.15137463808059692,
      "pose_rmse_mean": 0.26264292001724243,
      "rmse_dtheta": 0.049740247428417206,
      "rmse_dx": 0.022805964574217796,
      "rmse_dy": 0.011773308739066124,
      "rmse_mean": 0.028106508776545525,
      "rotation_flip": 0.0160213615745306,
      "sparse_tokens": 26841.0,
      "step": 8326,
      "turn_loss": 0.22357016801834106,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 37638.0,
      "epoch": 0.3868704701728303,
      "grad_norm": 0.59819495677948,
      "learning_rate": 2.1799672097499293e-06,
      "loss": 0.1337,
      "mae_dtheta": 0.02988027036190033,
      "mae_dx": 0.009599107317626476,
      "mae_dy": 0.005094387102872133,
      "pose_mae_dtheta": 0.2374301701784134,
      "pose_mae_dx": 0.07568331062793732,
      "pose_mae_dy": 0.04636317119002342,
      "pose_rmse_dtheta": 0.4495643973350525,
      "pose_rmse_dx": 0.1589246541261673,
      "pose_rmse_dy": 0.11740832030773163,
      "pose_rmse_mean": 0.24196580052375793,
      "rmse_dtheta": 0.04886031895875931,
      "rmse_dx": 0.019956501200795174,
      "rmse_dy": 0.011465274728834629,
      "rmse_mean": 0.02676069736480713,
      "rotation_flip": 0.01154734380543232,
      "sparse_tokens": 29006.0,
      "step": 8327,
      "turn_loss": 0.22517654299736023,
      "turns": 116.0,
      "turns_per_sample": 116.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.3869169299386731,
      "grad_norm": 0.5519153475761414,
      "learning_rate": 2.1788754590666645e-06,
      "loss": 0.1653,
      "mae_dtheta": 0.03203710913658142,
      "mae_dx": 0.011593113653361797,
      "mae_dy": 0.004586631432175636,
      "pose_mae_dtheta": 0.258113831281662,
      "pose_mae_dx": 0.09225162863731384,
      "pose_mae_dy": 0.06813656538724899,
      "pose_rmse_dtheta": 0.4691745340824127,
      "pose_rmse_dx": 0.2277756780385971,
      "pose_rmse_dy": 0.1651647537946701,
      "pose_rmse_mean": 0.2873716652393341,
      "rmse_dtheta": 0.04962276667356491,
      "rmse_dx": 0.025180334225296974,
      "rmse_dy": 0.008907398208975792,
      "rmse_mean": 0.027903500944375992,
      "rotation_flip": 0.013599274680018425,
      "sparse_tokens": 19346.0,
      "step": 8328,
      "turn_loss": 0.23507818579673767,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 12961.0,
      "epoch": 0.3869633897045159,
      "grad_norm": 0.3475177586078644,
      "learning_rate": 2.1777839056661555e-06,
      "loss": 0.0978,
      "mae_dtheta": 0.0401555635035038,
      "mae_dx": 0.0132819302380085,
      "mae_dy": 0.009537619538605213,
      "pose_mae_dtheta": 0.345610111951828,
      "pose_mae_dx": 0.1174410879611969,
      "pose_mae_dy": 0.09800911694765091,
      "pose_rmse_dtheta": 0.6166175007820129,
      "pose_rmse_dx": 0.25897642970085144,
      "pose_rmse_dy": 0.2257477045059204,
      "pose_rmse_mean": 0.3671138882637024,
      "rmse_dtheta": 0.06050502881407738,
      "rmse_dx": 0.026949403807520866,
      "rmse_dy": 0.020561527460813522,
      "rmse_mean": 0.03600531816482544,
      "rotation_flip": 0.004636785015463829,
      "sparse_tokens": 10705.0,
      "step": 8329,
      "turn_loss": 0.3997310698032379,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.38700984947035866,
      "grad_norm": 0.5282102227210999,
      "learning_rate": 2.1766925496247302e-06,
      "loss": 0.158,
      "mae_dtheta": 0.025737352669239044,
      "mae_dx": 0.012556364759802818,
      "mae_dy": 0.004932021722197533,
      "pose_mae_dtheta": 0.18134310841560364,
      "pose_mae_dx": 0.10427574813365936,
      "pose_mae_dy": 0.06407483667135239,
      "pose_rmse_dtheta": 0.3049583435058594,
      "pose_rmse_dx": 0.23083849251270294,
      "pose_rmse_dy": 0.13008372485637665,
      "pose_rmse_mean": 0.221960186958313,
      "rmse_dtheta": 0.039873626083135605,
      "rmse_dx": 0.025453787297010422,
      "rmse_dy": 0.009003544226288795,
      "rmse_mean": 0.024776985868811607,
      "rotation_flip": 0.014734773896634579,
      "sparse_tokens": 18550.0,
      "step": 8330,
      "turn_loss": 0.24825610220432281,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.38705630923620143,
      "grad_norm": 0.37507954239845276,
      "learning_rate": 2.175601391018713e-06,
      "loss": 0.057,
      "mae_dtheta": 0.005128058139234781,
      "mae_dx": 0.0015932511305436492,
      "mae_dy": 0.0007630371837876737,
      "pose_mae_dtheta": 0.03756913170218468,
      "pose_mae_dx": 0.014781778678297997,
      "pose_mae_dy": 0.013071378692984581,
      "pose_rmse_dtheta": 0.12333853542804718,
      "pose_rmse_dx": 0.04221440479159355,
      "pose_rmse_dy": 0.04489002376794815,
      "pose_rmse_mean": 0.07014765590429306,
      "rmse_dtheta": 0.01689470373094082,
      "rmse_dx": 0.005164198111742735,
      "rmse_dy": 0.0019354447722434998,
      "rmse_mean": 0.007998116314411163,
      "rotation_flip": 0.002801120514050126,
      "sparse_tokens": 32121.0,
      "step": 8331,
      "turn_loss": 0.05024417117238045,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.3871027690020442,
      "grad_norm": 0.9266146421432495,
      "learning_rate": 2.174510429924404e-06,
      "loss": 0.1911,
      "mae_dtheta": 0.027861816808581352,
      "mae_dx": 0.015801183879375458,
      "mae_dy": 0.004184893798083067,
      "pose_mae_dtheta": 0.22855497896671295,
      "pose_mae_dx": 0.13150517642498016,
      "pose_mae_dy": 0.07021117955446243,
      "pose_rmse_dtheta": 0.4643756151199341,
      "pose_rmse_dx": 0.2934909164905548,
      "pose_rmse_dy": 0.16288961470127106,
      "pose_rmse_mean": 0.3069187104701996,
      "rmse_dtheta": 0.0480128675699234,
      "rmse_dx": 0.03144429996609688,
      "rmse_dy": 0.008206159807741642,
      "rmse_mean": 0.029221108183264732,
      "rotation_flip": 0.00514579750597477,
      "sparse_tokens": 14460.0,
      "step": 8332,
      "turn_loss": 0.1710432916879654,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 23620.0,
      "epoch": 0.387149228767887,
      "grad_norm": 0.6196047067642212,
      "learning_rate": 2.173419666418099e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.03966902568936348,
      "mae_dx": 0.013125022873282433,
      "mae_dy": 0.0070319147780537605,
      "pose_mae_dtheta": 0.30170732736587524,
      "pose_mae_dx": 0.10063791275024414,
      "pose_mae_dy": 0.06377434730529785,
      "pose_rmse_dtheta": 0.5389163494110107,
      "pose_rmse_dx": 0.22004011273384094,
      "pose_rmse_dy": 0.15908297896385193,
      "pose_rmse_mean": 0.30601316690444946,
      "rmse_dtheta": 0.05856036767363548,
      "rmse_dx": 0.025533340871334076,
      "rmse_dy": 0.01565108262002468,
      "rmse_mean": 0.03324826434254646,
      "rotation_flip": 0.014585232362151146,
      "sparse_tokens": 17910.0,
      "step": 8333,
      "turn_loss": 0.31329330801963806,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.38719568853372976,
      "grad_norm": 0.5258538126945496,
      "learning_rate": 2.1723291005760722e-06,
      "loss": 0.0848,
      "mae_dtheta": 0.009853271767497063,
      "mae_dx": 0.0017605534521862864,
      "mae_dy": 0.002470452804118395,
      "pose_mae_dtheta": 0.06128145009279251,
      "pose_mae_dx": 0.022529006004333496,
      "pose_mae_dy": 0.0287209153175354,
      "pose_rmse_dtheta": 0.1359293907880783,
      "pose_rmse_dx": 0.05450807511806488,
      "pose_rmse_dy": 0.0596931166946888,
      "pose_rmse_mean": 0.08337686955928802,
      "rmse_dtheta": 0.020779035985469818,
      "rmse_dx": 0.00620502233505249,
      "rmse_dy": 0.005553805269300938,
      "rmse_mean": 0.010845954529941082,
      "rotation_flip": 0.005470887292176485,
      "sparse_tokens": 32073.0,
      "step": 8334,
      "turn_loss": 0.09455487877130508,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3872421482995726,
      "grad_norm": 0.8014877438545227,
      "learning_rate": 2.171238732474591e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.0076632509008049965,
      "mae_dx": 0.001509321155026555,
      "mae_dy": 0.001787241781130433,
      "pose_mae_dtheta": 0.050135087221860886,
      "pose_mae_dx": 0.01958135887980461,
      "pose_mae_dy": 0.019932787865400314,
      "pose_rmse_dtheta": 0.12389861047267914,
      "pose_rmse_dx": 0.04736710339784622,
      "pose_rmse_dy": 0.04557030275464058,
      "pose_rmse_mean": 0.07227867841720581,
      "rmse_dtheta": 0.01798851042985916,
      "rmse_dx": 0.00496287364512682,
      "rmse_dy": 0.004221441689878702,
      "rmse_mean": 0.009057608433067799,
      "rotation_flip": 0.0057026478461921215,
      "sparse_tokens": 32121.0,
      "step": 8335,
      "turn_loss": 0.06505008041858673,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.3872886080654154,
      "grad_norm": 0.4555342495441437,
      "learning_rate": 2.1701485621899014e-06,
      "loss": 0.103,
      "mae_dtheta": 0.03841793164610863,
      "mae_dx": 0.010556448251008987,
      "mae_dy": 0.003952755127102137,
      "pose_mae_dtheta": 0.32884421944618225,
      "pose_mae_dx": 0.08896870166063309,
      "pose_mae_dy": 0.05589267238974571,
      "pose_rmse_dtheta": 0.6144943237304688,
      "pose_rmse_dx": 0.21581637859344482,
      "pose_rmse_dy": 0.13613687455654144,
      "pose_rmse_mean": 0.32214921712875366,
      "rmse_dtheta": 0.06124749407172203,
      "rmse_dx": 0.022969398647546768,
      "rmse_dy": 0.007863220758736134,
      "rmse_mean": 0.03069337271153927,
      "rotation_flip": 0.0077821011655032635,
      "sparse_tokens": 8590.0,
      "step": 8336,
      "turn_loss": 0.20530512928962708,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.38733506783125815,
      "grad_norm": 0.4059544801712036,
      "learning_rate": 2.1690585897982423e-06,
      "loss": 0.0893,
      "mae_dtheta": 0.0053289541974663734,
      "mae_dx": 0.0007562559330835938,
      "mae_dy": 0.001046611461788416,
      "pose_mae_dtheta": 0.03570898622274399,
      "pose_mae_dx": 0.008729317225515842,
      "pose_mae_dy": 0.01678849197924137,
      "pose_rmse_dtheta": 0.09261433780193329,
      "pose_rmse_dx": 0.021986735984683037,
      "pose_rmse_dy": 0.038605254143476486,
      "pose_rmse_mean": 0.051068779081106186,
      "rmse_dtheta": 0.014607522636651993,
      "rmse_dx": 0.002540737623348832,
      "rmse_dy": 0.0021792291663587093,
      "rmse_mean": 0.006442496553063393,
      "rotation_flip": 0.0,
      "sparse_tokens": 32073.0,
      "step": 8337,
      "turn_loss": 0.03914673626422882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.3873815275971009,
      "grad_norm": 0.5147676467895508,
      "learning_rate": 2.1679688153758373e-06,
      "loss": 0.1138,
      "mae_dtheta": 0.03119344636797905,
      "mae_dx": 0.010751691646873951,
      "mae_dy": 0.005213434807956219,
      "pose_mae_dtheta": 0.23542234301567078,
      "pose_mae_dx": 0.07754574716091156,
      "pose_mae_dy": 0.053714342415332794,
      "pose_rmse_dtheta": 0.4532482326030731,
      "pose_rmse_dx": 0.20933398604393005,
      "pose_rmse_dy": 0.12308315932750702,
      "pose_rmse_mean": 0.2618884742259979,
      "rmse_dtheta": 0.05117714777588844,
      "rmse_dx": 0.023805249482393265,
      "rmse_dy": 0.009822101332247257,
      "rmse_mean": 0.02826816588640213,
      "rotation_flip": 0.012544803321361542,
      "sparse_tokens": 9305.0,
      "step": 8338,
      "turn_loss": 0.24935834109783173,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.3874279873629437,
      "grad_norm": 0.9873805642127991,
      "learning_rate": 2.166879238998891e-06,
      "loss": 0.2312,
      "mae_dtheta": 0.026898564770817757,
      "mae_dx": 0.010432287119328976,
      "mae_dy": 0.005525534972548485,
      "pose_mae_dtheta": 0.1928042322397232,
      "pose_mae_dx": 0.09526115655899048,
      "pose_mae_dy": 0.06296393275260925,
      "pose_rmse_dtheta": 0.34957045316696167,
      "pose_rmse_dx": 0.22216591238975525,
      "pose_rmse_dy": 0.1548808366060257,
      "pose_rmse_mean": 0.24220572412014008,
      "rmse_dtheta": 0.04511372745037079,
      "rmse_dx": 0.021736571565270424,
      "rmse_dy": 0.012530945241451263,
      "rmse_mean": 0.02646041475236416,
      "rotation_flip": 0.012891344726085663,
      "sparse_tokens": 11180.0,
      "step": 8339,
      "turn_loss": 0.23028668761253357,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 40114.0,
      "epoch": 0.3874744471287865,
      "grad_norm": 0.48139700293540955,
      "learning_rate": 2.165789860743602e-06,
      "loss": 0.1169,
      "mae_dtheta": 0.03421204909682274,
      "mae_dx": 0.012385335750877857,
      "mae_dy": 0.0046205841936171055,
      "pose_mae_dtheta": 0.2916145920753479,
      "pose_mae_dx": 0.10053186863660812,
      "pose_mae_dy": 0.0627138540148735,
      "pose_rmse_dtheta": 0.48207199573516846,
      "pose_rmse_dx": 0.2215007245540619,
      "pose_rmse_dy": 0.15848439931869507,
      "pose_rmse_mean": 0.28735238313674927,
      "rmse_dtheta": 0.0502290204167366,
      "rmse_dx": 0.025057068094611168,
      "rmse_dy": 0.009892881847918034,
      "rmse_mean": 0.028392991051077843,
      "rotation_flip": 0.014657980762422085,
      "sparse_tokens": 29914.0,
      "step": 8340,
      "turn_loss": 0.27601245045661926,
      "turns": 124.0,
      "turns_per_sample": 124.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.38752090689462926,
      "grad_norm": 0.692445695400238,
      "learning_rate": 2.1647006806861472e-06,
      "loss": 0.1649,
      "mae_dtheta": 0.012308244593441486,
      "mae_dx": 0.001915262546390295,
      "mae_dy": 0.0030393130145967007,
      "pose_mae_dtheta": 0.08176438510417938,
      "pose_mae_dx": 0.031171349808573723,
      "pose_mae_dy": 0.038592539727687836,
      "pose_rmse_dtheta": 0.17691057920455933,
      "pose_rmse_dx": 0.07917436212301254,
      "pose_rmse_dy": 0.09736134111881256,
      "pose_rmse_mean": 0.11781543493270874,
      "rmse_dtheta": 0.02333522029221058,
      "rmse_dx": 0.005211236421018839,
      "rmse_dy": 0.006249770987778902,
      "rmse_mean": 0.011598742567002773,
      "rotation_flip": 0.008080030791461468,
      "sparse_tokens": 32089.0,
      "step": 8341,
      "turn_loss": 0.11603492498397827,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.38756736666047203,
      "grad_norm": 0.45516538619995117,
      "learning_rate": 2.163611698902697e-06,
      "loss": 0.1141,
      "mae_dtheta": 0.03275984153151512,
      "mae_dx": 0.00920009519904852,
      "mae_dy": 0.007661059964448214,
      "pose_mae_dtheta": 0.23734286427497864,
      "pose_mae_dx": 0.06051583215594292,
      "pose_mae_dy": 0.08704914152622223,
      "pose_rmse_dtheta": 0.3715150058269501,
      "pose_rmse_dx": 0.13964571058750153,
      "pose_rmse_dy": 0.15600956976413727,
      "pose_rmse_mean": 0.2223901003599167,
      "rmse_dtheta": 0.04583200439810753,
      "rmse_dx": 0.020907800644636154,
      "rmse_dy": 0.012938394211232662,
      "rmse_mean": 0.02655940130352974,
      "rotation_flip": 0.04109589010477066,
      "sparse_tokens": 2639.0,
      "step": 8342,
      "turn_loss": 0.26212096214294434,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3876138264263148,
      "grad_norm": 0.39272114634513855,
      "learning_rate": 2.162522915469402e-06,
      "loss": 0.0962,
      "mae_dtheta": 0.008853130042552948,
      "mae_dx": 0.0026182588189840317,
      "mae_dy": 0.0022838155273348093,
      "pose_mae_dtheta": 0.05998855084180832,
      "pose_mae_dx": 0.018935931846499443,
      "pose_mae_dy": 0.019220102578401566,
      "pose_rmse_dtheta": 0.16945119202136993,
      "pose_rmse_dx": 0.05368460714817047,
      "pose_rmse_dy": 0.047768909484148026,
      "pose_rmse_mean": 0.09030157327651978,
      "rmse_dtheta": 0.024436697363853455,
      "rmse_dx": 0.0076082125306129456,
      "rmse_dy": 0.007509492337703705,
      "rmse_mean": 0.013184800744056702,
      "rotation_flip": 0.0138248847797513,
      "sparse_tokens": 32089.0,
      "step": 8343,
      "turn_loss": 0.10862742364406586,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3876602861921576,
      "grad_norm": 0.6202399134635925,
      "learning_rate": 2.1614343304624025e-06,
      "loss": 0.1547,
      "mae_dtheta": 0.009009888395667076,
      "mae_dx": 0.0013851593248546124,
      "mae_dy": 0.0023971989285200834,
      "pose_mae_dtheta": 0.051416605710983276,
      "pose_mae_dx": 0.016424760222434998,
      "pose_mae_dy": 0.023700512945652008,
      "pose_rmse_dtheta": 0.1028771698474884,
      "pose_rmse_dx": 0.038666415959596634,
      "pose_rmse_dy": 0.05750086531043053,
      "pose_rmse_mean": 0.06634815037250519,
      "rmse_dtheta": 0.018823768943548203,
      "rmse_dx": 0.00333725125528872,
      "rmse_dy": 0.005141720175743103,
      "rmse_mean": 0.009100914001464844,
      "rotation_flip": 0.01140007097274065,
      "sparse_tokens": 32153.0,
      "step": 8344,
      "turn_loss": 0.09775466471910477,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.38770674595800036,
      "grad_norm": 0.5219200253486633,
      "learning_rate": 2.160345943957825e-06,
      "loss": 0.1036,
      "mae_dtheta": 0.008109821006655693,
      "mae_dx": 0.0015394799411296844,
      "mae_dy": 0.002304777968674898,
      "pose_mae_dtheta": 0.05773189291357994,
      "pose_mae_dx": 0.021700775250792503,
      "pose_mae_dy": 0.022445250302553177,
      "pose_rmse_dtheta": 0.16492868959903717,
      "pose_rmse_dx": 0.06067707762122154,
      "pose_rmse_dy": 0.05575265735387802,
      "pose_rmse_mean": 0.09378614276647568,
      "rmse_dtheta": 0.020083112642169,
      "rmse_dx": 0.004660554230213165,
      "rmse_dy": 0.005481565371155739,
      "rmse_mean": 0.010075077414512634,
      "rotation_flip": 0.0021739129442721605,
      "sparse_tokens": 32089.0,
      "step": 8345,
      "turn_loss": 0.07070871442556381,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1340.0,
      "epoch": 0.38775320572384314,
      "grad_norm": 0.4569522738456726,
      "learning_rate": 2.1592577560317784e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.027481207624077797,
      "mae_dx": 0.034559495747089386,
      "mae_dy": 0.008759048767387867,
      "pose_mae_dtheta": 0.20547930896282196,
      "pose_mae_dx": 0.24102357029914856,
      "pose_mae_dy": 0.1494828164577484,
      "pose_rmse_dtheta": 0.3296343982219696,
      "pose_rmse_dx": 0.4746752977371216,
      "pose_rmse_dy": 0.22941982746124268,
      "pose_rmse_mean": 0.34457653760910034,
      "rmse_dtheta": 0.03618359565734863,
      "rmse_dx": 0.04863233491778374,
      "rmse_dy": 0.01186955627053976,
      "rmse_mean": 0.0322284996509552,
      "rotation_flip": 0.0,
      "sparse_tokens": 1159.0,
      "step": 8346,
      "turn_loss": 0.40413516759872437,
      "turns": 4.0,
      "turns_per_sample": 4.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.3877996654896859,
      "grad_norm": 0.8491105437278748,
      "learning_rate": 2.1581697667603634e-06,
      "loss": 0.1388,
      "mae_dtheta": 0.023137258365750313,
      "mae_dx": 0.005058906506747007,
      "mae_dy": 0.003893527900800109,
      "pose_mae_dtheta": 0.1627764105796814,
      "pose_mae_dx": 0.036683596670627594,
      "pose_mae_dy": 0.05639854073524475,
      "pose_rmse_dtheta": 0.2806521952152252,
      "pose_rmse_dx": 0.08026154339313507,
      "pose_rmse_dy": 0.12304159998893738,
      "pose_rmse_mean": 0.16131845116615295,
      "rmse_dtheta": 0.03801589459180832,
      "rmse_dx": 0.012419754639267921,
      "rmse_dy": 0.0073731266893446445,
      "rmse_mean": 0.019269593060016632,
      "rotation_flip": 0.02056555263698101,
      "sparse_tokens": 6422.0,
      "step": 8347,
      "turn_loss": 0.1470630168914795,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3878461252555287,
      "grad_norm": 0.41198208928108215,
      "learning_rate": 2.1570819762196605e-06,
      "loss": 0.0949,
      "mae_dtheta": 0.008881759829819202,
      "mae_dx": 0.0010840893955901265,
      "mae_dy": 0.0017786362441256642,
      "pose_mae_dtheta": 0.05265935882925987,
      "pose_mae_dx": 0.013141916133463383,
      "pose_mae_dy": 0.0218901876360178,
      "pose_rmse_dtheta": 0.11865383386611938,
      "pose_rmse_dx": 0.03137458488345146,
      "pose_rmse_dy": 0.04913938790559769,
      "pose_rmse_mean": 0.06638927757740021,
      "rmse_dtheta": 0.01929030753672123,
      "rmse_dx": 0.003537144511938095,
      "rmse_dy": 0.004449936095625162,
      "rmse_mean": 0.009092463180422783,
      "rotation_flip": 0.008105802349746227,
      "sparse_tokens": 32089.0,
      "step": 8348,
      "turn_loss": 0.05921937897801399,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.38789258502137147,
      "grad_norm": 0.45768672227859497,
      "learning_rate": 2.155994384485742e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.010518919676542282,
      "mae_dx": 0.002061726525425911,
      "mae_dy": 0.0028413294348865747,
      "pose_mae_dtheta": 0.07248088717460632,
      "pose_mae_dx": 0.023340869694948196,
      "pose_mae_dy": 0.024654246866703033,
      "pose_rmse_dtheta": 0.2336876541376114,
      "pose_rmse_dx": 0.07151184976100922,
      "pose_rmse_dy": 0.06847503036260605,
      "pose_rmse_mean": 0.12455818057060242,
      "rmse_dtheta": 0.02708248794078827,
      "rmse_dx": 0.006883285474032164,
      "rmse_dy": 0.007620544172823429,
      "rmse_mean": 0.013862106017768383,
      "rotation_flip": 0.008106819353997707,
      "sparse_tokens": 32057.0,
      "step": 8349,
      "turn_loss": 0.09326164424419403,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19096.0,
      "epoch": 0.38793904478721425,
      "grad_norm": 0.5868510007858276,
      "learning_rate": 2.1549069916346614e-06,
      "loss": 0.1441,
      "mae_dtheta": 0.03721102699637413,
      "mae_dx": 0.009357708506286144,
      "mae_dy": 0.00573936989530921,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.586851179599762,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 141.8420867919922,
      "model/head/act_norm_mean": 108.03394796080508,
      "model/head/act_norm_min": 72.37710571289062,
      "model/head/act_over_embed": 74.24194046842139,
      "model/head/grad_frac": 0.10535664111375809,
      "model/head/grad_norm": 0.06182866916060448,
      "model/head/grad_zero_frac": 0.00020749573013745248,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6946669756355932,
      "model/head/update_ratio": 0.001053217682056129,
      "model/head/weight_delta": 9.753684997558594,
      "model/head/weight_delta_rel": 0.17110852897167206,
      "model/head/weight_norm": 58.704551696777344,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4222750961780548,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222750961780548,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4222750961780548,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29019139949529654,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12856875360012054,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07545072585344315,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0024365135468542576,
      "model/modality_embedder.encoders.pose/weight_delta": 3.112400531768799,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1016918271780014,
      "model/modality_embedder.encoders.pose/weight_norm": 30.9666748046875,
      "model/modality_embedder/grad_frac": 0.12856875360012054,
      "model/modality_embedder/grad_norm": 0.07545072585344315,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0024365135468542576,
      "model/modality_embedder/weight_delta": 3.112400531768799,
      "model/modality_embedder/weight_delta_rel": 0.1016918271780014,
      "model/modality_embedder/weight_norm": 30.9666748046875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.0484390258789,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.42601980764057,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.213330268859863,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.09858012966345,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0825541764497757,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04844701662659645,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017342603532597423,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6264524459838867,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09570951014757156,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.935260772705078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.22659301757812,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.23871737960721,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.66606616973877,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.657073509713467,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07505722343921661,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04404741898179054,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001481614075601101,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3306384086608887,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11537592113018036,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.729347229003906,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.45707702636719,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.88103225047081,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.057550430297852,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.785687664565,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07174830883741379,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.042105577886104584,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013716151006519794,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.602006435394287,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12094863504171371,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.69780921936035,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.98249816894531,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.75093531409739,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.232775688171387,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.070702556197485,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07014252990484238,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04116322845220566,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013757164124399424,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0883727073669434,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10554592311382294,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.921302795410156,
      "model/normalizer/grad_frac": 0.29779577255249023,
      "model/normalizer/grad_norm": 0.1747618019580841,
      "model/normalizer/grad_zero_frac": 0.00021507639030460268,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0022231137845665216,
      "model/normalizer/weight_delta": 6.512346267700195,
      "model/normalizer/weight_delta_rel": 0.08387524634599686,
      "model/normalizer/weight_norm": 78.61127471923828,
      "pose_mae_dtheta": 0.3062959909439087,
      "pose_mae_dx": 0.06563445925712585,
      "pose_mae_dy": 0.056639887392520905,
      "pose_rmse_dtheta": 0.59270179271698,
      "pose_rmse_dx": 0.1653125137090683,
      "pose_rmse_dy": 0.14341400563716888,
      "pose_rmse_mean": 0.3004761338233948,
      "rmse_dtheta": 0.058677271008491516,
      "rmse_dx": 0.01994684897363186,
      "rmse_dy": 0.012889107689261436,
      "rmse_mean": 0.030504411086440086,
      "rotation_flip": 0.0044843051582574844,
      "sparse_tokens": 15312.0,
      "step": 8350,
      "turn_loss": 0.2867663502693176,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.387985504553057,
      "grad_norm": 0.3890613913536072,
      "learning_rate": 2.153819797742462e-06,
      "loss": 0.0824,
      "mae_dtheta": 0.008581201545894146,
      "mae_dx": 0.0016017528250813484,
      "mae_dy": 0.001718432642519474,
      "pose_mae_dtheta": 0.056950636208057404,
      "pose_mae_dx": 0.016218187287449837,
      "pose_mae_dy": 0.021620726212859154,
      "pose_rmse_dtheta": 0.12121159583330154,
      "pose_rmse_dx": 0.03743767738342285,
      "pose_rmse_dy": 0.0495234951376915,
      "pose_rmse_mean": 0.0693909227848053,
      "rmse_dtheta": 0.01814712956547737,
      "rmse_dx": 0.004776610992848873,
      "rmse_dy": 0.0036139218136668205,
      "rmse_mean": 0.008845888078212738,
      "rotation_flip": 0.003319808281958103,
      "sparse_tokens": 32185.0,
      "step": 8351,
      "turn_loss": 0.06497031450271606,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.38803196431889986,
      "grad_norm": 0.7329604029655457,
      "learning_rate": 2.1527328028851735e-06,
      "loss": 0.169,
      "mae_dtheta": 0.03020230494439602,
      "mae_dx": 0.011778142303228378,
      "mae_dy": 0.004943171516060829,
      "pose_mae_dtheta": 0.23292230069637299,
      "pose_mae_dx": 0.10411951690912247,
      "pose_mae_dy": 0.062402527779340744,
      "pose_rmse_dtheta": 0.39838653802871704,
      "pose_rmse_dx": 0.24158447980880737,
      "pose_rmse_dy": 0.13176028430461884,
      "pose_rmse_mean": 0.2572437822818756,
      "rmse_dtheta": 0.04642384126782417,
      "rmse_dx": 0.024884497746825218,
      "rmse_dy": 0.009572760201990604,
      "rmse_mean": 0.02696036547422409,
      "rotation_flip": 0.010506208054721355,
      "sparse_tokens": 21826.0,
      "step": 8352,
      "turn_loss": 0.2721961736679077,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.38807842408474263,
      "grad_norm": 0.6613790988922119,
      "learning_rate": 2.1516460071388062e-06,
      "loss": 0.1781,
      "mae_dtheta": 0.040824566036462784,
      "mae_dx": 0.010019835084676743,
      "mae_dy": 0.0041779158636927605,
      "pose_mae_dtheta": 0.3556171953678131,
      "pose_mae_dx": 0.07393965870141983,
      "pose_mae_dy": 0.040667999535799026,
      "pose_rmse_dtheta": 0.5799487829208374,
      "pose_rmse_dx": 0.16540087759494781,
      "pose_rmse_dy": 0.09024473279714584,
      "pose_rmse_mean": 0.2785314619541168,
      "rmse_dtheta": 0.05823574215173721,
      "rmse_dx": 0.01964598521590233,
      "rmse_dy": 0.009929196909070015,
      "rmse_mean": 0.02927030622959137,
      "rotation_flip": 0.009852216579020023,
      "sparse_tokens": 9008.0,
      "step": 8353,
      "turn_loss": 0.2547623813152313,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3881248838505854,
      "grad_norm": 0.5235491991043091,
      "learning_rate": 2.1505594105793643e-06,
      "loss": 0.1185,
      "mae_dtheta": 0.008538438007235527,
      "mae_dx": 0.0015689476858824492,
      "mae_dy": 0.0017455597408115864,
      "pose_mae_dtheta": 0.05224081128835678,
      "pose_mae_dx": 0.016087384894490242,
      "pose_mae_dy": 0.024612557142972946,
      "pose_rmse_dtheta": 0.10692314803600311,
      "pose_rmse_dx": 0.039705779403448105,
      "pose_rmse_dy": 0.058483585715293884,
      "pose_rmse_mean": 0.06837084144353867,
      "rmse_dtheta": 0.01747838407754898,
      "rmse_dx": 0.00495619373396039,
      "rmse_dy": 0.003487963927909732,
      "rmse_mean": 0.00864084716886282,
      "rotation_flip": 0.005758157465606928,
      "sparse_tokens": 32089.0,
      "step": 8354,
      "turn_loss": 0.08167143911123276,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.3881713436164282,
      "grad_norm": 0.5006142854690552,
      "learning_rate": 2.149473013282831e-06,
      "loss": 0.1736,
      "mae_dtheta": 0.026393741369247437,
      "mae_dx": 0.007478807121515274,
      "mae_dy": 0.0017629610374569893,
      "pose_mae_dtheta": 0.20148615539073944,
      "pose_mae_dx": 0.055894482880830765,
      "pose_mae_dy": 0.016149548813700676,
      "pose_rmse_dtheta": 0.3918454647064209,
      "pose_rmse_dx": 0.13566666841506958,
      "pose_rmse_dy": 0.04079847410321236,
      "pose_rmse_mean": 0.1894368827342987,
      "rmse_dtheta": 0.04524228721857071,
      "rmse_dx": 0.017200814560055733,
      "rmse_dy": 0.004179317504167557,
      "rmse_mean": 0.0222074743360281,
      "rotation_flip": 0.007621951401233673,
      "sparse_tokens": 11860.0,
      "step": 8355,
      "turn_loss": 0.19997034966945648,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.38821780338227097,
      "grad_norm": 0.4218026399612427,
      "learning_rate": 2.148386815325179e-06,
      "loss": 0.094,
      "mae_dtheta": 0.012580804526805878,
      "mae_dx": 0.0021917845588177443,
      "mae_dy": 0.002220412017777562,
      "pose_mae_dtheta": 0.07951794564723969,
      "pose_mae_dx": 0.019307052716612816,
      "pose_mae_dy": 0.0255954060703516,
      "pose_rmse_dtheta": 0.18682393431663513,
      "pose_rmse_dx": 0.04477868601679802,
      "pose_rmse_dy": 0.05772464722394943,
      "pose_rmse_mean": 0.09644242376089096,
      "rmse_dtheta": 0.025416439399123192,
      "rmse_dx": 0.006837288849055767,
      "rmse_dy": 0.004315576981753111,
      "rmse_mean": 0.012189768254756927,
      "rotation_flip": 0.009821753017604351,
      "sparse_tokens": 32137.0,
      "step": 8356,
      "turn_loss": 0.11124356836080551,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.38826426314811374,
      "grad_norm": 0.8965882658958435,
      "learning_rate": 2.1473008167823694e-06,
      "loss": 0.295,
      "mae_dtheta": 0.04920152947306633,
      "mae_dx": 0.010112913325428963,
      "mae_dy": 0.002537527121603489,
      "pose_mae_dtheta": 0.3898289203643799,
      "pose_mae_dx": 0.08503886312246323,
      "pose_mae_dy": 0.02755848877131939,
      "pose_rmse_dtheta": 0.5891373753547668,
      "pose_rmse_dx": 0.19935163855552673,
      "pose_rmse_dy": 0.0719451978802681,
      "pose_rmse_mean": 0.2868114113807678,
      "rmse_dtheta": 0.0660567358136177,
      "rmse_dx": 0.02157432585954666,
      "rmse_dy": 0.006434599868953228,
      "rmse_mean": 0.03135522082448006,
      "rotation_flip": 0.018675722181797028,
      "sparse_tokens": 9316.0,
      "step": 8357,
      "turn_loss": 0.1967131644487381,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.3883107229139565,
      "grad_norm": 0.593360960483551,
      "learning_rate": 2.1462150177303436e-06,
      "loss": 0.1499,
      "mae_dtheta": 0.039591021835803986,
      "mae_dx": 0.008766701444983482,
      "mae_dy": 0.002948580775409937,
      "pose_mae_dtheta": 0.27784520387649536,
      "pose_mae_dx": 0.06156956031918526,
      "pose_mae_dy": 0.025921465829014778,
      "pose_rmse_dtheta": 0.4877507984638214,
      "pose_rmse_dx": 0.15187545120716095,
      "pose_rmse_dy": 0.07644909620285034,
      "pose_rmse_mean": 0.2386917918920517,
      "rmse_dtheta": 0.060154929757118225,
      "rmse_dx": 0.019659513607621193,
      "rmse_dy": 0.009008944034576416,
      "rmse_mean": 0.02960779517889023,
      "rotation_flip": 0.0125570772215724,
      "sparse_tokens": 14124.0,
      "step": 8358,
      "turn_loss": 0.2755800485610962,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.3883571826797993,
      "grad_norm": 0.5995367765426636,
      "learning_rate": 2.145129418245035e-06,
      "loss": 0.1193,
      "mae_dtheta": 0.04551601782441139,
      "mae_dx": 0.02231060341000557,
      "mae_dy": 0.018881438300013542,
      "pose_mae_dtheta": 0.3654836416244507,
      "pose_mae_dx": 0.1541566103696823,
      "pose_mae_dy": 0.20351028442382812,
      "pose_rmse_dtheta": 0.595177412033081,
      "pose_rmse_dx": 0.29583650827407837,
      "pose_rmse_dy": 0.4283885657787323,
      "pose_rmse_mean": 0.43980082869529724,
      "rmse_dtheta": 0.06672469526529312,
      "rmse_dx": 0.03621131181716919,
      "rmse_dy": 0.03482174500823021,
      "rmse_mean": 0.04591925069689751,
      "rotation_flip": 0.009230769239366055,
      "sparse_tokens": 5796.0,
      "step": 8359,
      "turn_loss": 0.7173829674720764,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.38840364244564207,
      "grad_norm": 0.5615739226341248,
      "learning_rate": 2.1440440184023563e-06,
      "loss": 0.076,
      "mae_dtheta": 0.031571608036756516,
      "mae_dx": 0.007149165030568838,
      "mae_dy": 0.0048170010559260845,
      "pose_mae_dtheta": 0.2506236732006073,
      "pose_mae_dx": 0.07106977701187134,
      "pose_mae_dy": 0.08745095878839493,
      "pose_rmse_dtheta": 0.48573037981987,
      "pose_rmse_dx": 0.16131392121315002,
      "pose_rmse_dy": 0.17708353698253632,
      "pose_rmse_mean": 0.2747092843055725,
      "rmse_dtheta": 0.05162833631038666,
      "rmse_dx": 0.01626688800752163,
      "rmse_dy": 0.008195653557777405,
      "rmse_mean": 0.025363627821207047,
      "rotation_flip": 0.01592356711626053,
      "sparse_tokens": 5895.0,
      "step": 8360,
      "turn_loss": 0.16419969499111176,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.38845010221148485,
      "grad_norm": 1.0673400163650513,
      "learning_rate": 2.1429588182782147e-06,
      "loss": 0.1396,
      "mae_dtheta": 0.03321502357721329,
      "mae_dx": 0.009891862981021404,
      "mae_dy": 0.00404568575322628,
      "pose_mae_dtheta": 0.2448715716600418,
      "pose_mae_dx": 0.07767776399850845,
      "pose_mae_dy": 0.042000021785497665,
      "pose_rmse_dtheta": 0.4765695631504059,
      "pose_rmse_dx": 0.17136231064796448,
      "pose_rmse_dy": 0.09933240711688995,
      "pose_rmse_mean": 0.2490880936384201,
      "rmse_dtheta": 0.05161689221858978,
      "rmse_dx": 0.020947521552443504,
      "rmse_dy": 0.007524792104959488,
      "rmse_mean": 0.026696404442191124,
      "rotation_flip": 0.010663507506251335,
      "sparse_tokens": 15668.0,
      "step": 8361,
      "turn_loss": 0.2274959236383438,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3884965619773276,
      "grad_norm": 0.41342851519584656,
      "learning_rate": 2.141873817948494e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.01208677887916565,
      "mae_dx": 0.002328155329450965,
      "mae_dy": 0.003028044942766428,
      "pose_mae_dtheta": 0.08495642244815826,
      "pose_mae_dx": 0.028067035600543022,
      "pose_mae_dy": 0.034812312573194504,
      "pose_rmse_dtheta": 0.19046935439109802,
      "pose_rmse_dx": 0.0713551715016365,
      "pose_rmse_dy": 0.08158279955387115,
      "pose_rmse_mean": 0.11446911096572876,
      "rmse_dtheta": 0.024095609784126282,
      "rmse_dx": 0.0069228895008563995,
      "rmse_dy": 0.0064020617865026,
      "rmse_mean": 0.012473519891500473,
      "rotation_flip": 0.007711181417107582,
      "sparse_tokens": 32089.0,
      "step": 8362,
      "turn_loss": 0.11189420521259308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3885430217431704,
      "grad_norm": 0.4655980169773102,
      "learning_rate": 2.140789017489073e-06,
      "loss": 0.0773,
      "mae_dtheta": 0.007057194132357836,
      "mae_dx": 0.0017328514950349927,
      "mae_dy": 0.0013303954619914293,
      "pose_mae_dtheta": 0.04646515101194382,
      "pose_mae_dx": 0.01790926419198513,
      "pose_mae_dy": 0.0170583575963974,
      "pose_rmse_dtheta": 0.1316162794828415,
      "pose_rmse_dx": 0.05522929131984711,
      "pose_rmse_dy": 0.05659114196896553,
      "pose_rmse_mean": 0.08114556968212128,
      "rmse_dtheta": 0.01795697957277298,
      "rmse_dx": 0.006034122314304113,
      "rmse_dy": 0.0034820344299077988,
      "rmse_mean": 0.009157712571322918,
      "rotation_flip": 0.0016420361353084445,
      "sparse_tokens": 32073.0,
      "step": 8363,
      "turn_loss": 0.05629803612828255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3885894815090132,
      "grad_norm": 0.4626043438911438,
      "learning_rate": 2.13970441697581e-06,
      "loss": 0.0904,
      "mae_dtheta": 0.006064734887331724,
      "mae_dx": 0.0014107458991929889,
      "mae_dy": 0.0009075998095795512,
      "pose_mae_dtheta": 0.043051861226558685,
      "pose_mae_dx": 0.011380212381482124,
      "pose_mae_dy": 0.009329309687018394,
      "pose_rmse_dtheta": 0.18909764289855957,
      "pose_rmse_dx": 0.03221677243709564,
      "pose_rmse_dy": 0.02778899483382702,
      "pose_rmse_mean": 0.0830344706773758,
      "rmse_dtheta": 0.021718403324484825,
      "rmse_dx": 0.004840971902012825,
      "rmse_dy": 0.003213019808754325,
      "rmse_mean": 0.009924132376909256,
      "rotation_flip": 0.0021246459800750017,
      "sparse_tokens": 32105.0,
      "step": 8364,
      "turn_loss": 0.055803198367357254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.38863594127485596,
      "grad_norm": 0.4303600788116455,
      "learning_rate": 2.1386200164845527e-06,
      "loss": 0.1293,
      "mae_dtheta": 0.011920418590307236,
      "mae_dx": 0.0021617033053189516,
      "mae_dy": 0.00264407554641366,
      "pose_mae_dtheta": 0.08519230037927628,
      "pose_mae_dx": 0.029499780386686325,
      "pose_mae_dy": 0.03288726881146431,
      "pose_rmse_dtheta": 0.23223894834518433,
      "pose_rmse_dx": 0.08964751660823822,
      "pose_rmse_dy": 0.08051461726427078,
      "pose_rmse_mean": 0.1341336965560913,
      "rmse_dtheta": 0.0256199911236763,
      "rmse_dx": 0.007510376162827015,
      "rmse_dy": 0.005942590534687042,
      "rmse_mean": 0.01302431896328926,
      "rotation_flip": 0.005743243265897036,
      "sparse_tokens": 32089.0,
      "step": 8365,
      "turn_loss": 0.09046938270330429,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.38868240104069873,
      "grad_norm": 0.4252331256866455,
      "learning_rate": 2.1375358160911325e-06,
      "loss": 0.102,
      "mae_dtheta": 0.010930783115327358,
      "mae_dx": 0.0018374740611761808,
      "mae_dy": 0.0023142939899116755,
      "pose_mae_dtheta": 0.08089997619390488,
      "pose_mae_dx": 0.02440427802503109,
      "pose_mae_dy": 0.031750693917274475,
      "pose_rmse_dtheta": 0.21877676248550415,
      "pose_rmse_dx": 0.06363978236913681,
      "pose_rmse_dy": 0.08043406903743744,
      "pose_rmse_mean": 0.12095020711421967,
      "rmse_dtheta": 0.02522807940840721,
      "rmse_dx": 0.006030858028680086,
      "rmse_dy": 0.005953521467745304,
      "rmse_mean": 0.012404153123497963,
      "rotation_flip": 0.006026889197528362,
      "sparse_tokens": 32073.0,
      "step": 8366,
      "turn_loss": 0.08489557355642319,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3887288608065415,
      "grad_norm": 0.6128073930740356,
      "learning_rate": 2.1364518158713703e-06,
      "loss": 0.1365,
      "mae_dtheta": 0.01708919182419777,
      "mae_dx": 0.0035803010687232018,
      "mae_dy": 0.005186508409678936,
      "pose_mae_dtheta": 0.12137588113546371,
      "pose_mae_dx": 0.04922432824969292,
      "pose_mae_dy": 0.04733066260814667,
      "pose_rmse_dtheta": 0.2583429217338562,
      "pose_rmse_dx": 0.11237093061208725,
      "pose_rmse_dy": 0.1027178093791008,
      "pose_rmse_mean": 0.15781056880950928,
      "rmse_dtheta": 0.03284493833780289,
      "rmse_dx": 0.008470894768834114,
      "rmse_dy": 0.010833678767085075,
      "rmse_mean": 0.017383171245455742,
      "rotation_flip": 0.006558401044458151,
      "sparse_tokens": 32153.0,
      "step": 8367,
      "turn_loss": 0.14977310597896576,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.38877532057238434,
      "grad_norm": 0.6693445444107056,
      "learning_rate": 2.135368015901068e-06,
      "loss": 0.0908,
      "mae_dtheta": 0.02631998620927334,
      "mae_dx": 0.01075657643377781,
      "mae_dy": 0.0040545156225562096,
      "pose_mae_dtheta": 0.18609875440597534,
      "pose_mae_dx": 0.09068845957517624,
      "pose_mae_dy": 0.04548560455441475,
      "pose_rmse_dtheta": 0.36853086948394775,
      "pose_rmse_dx": 0.1917232722043991,
      "pose_rmse_dy": 0.10109752416610718,
      "pose_rmse_mean": 0.22045056521892548,
      "rmse_dtheta": 0.04488174989819527,
      "rmse_dx": 0.022518880665302277,
      "rmse_dy": 0.007372885011136532,
      "rmse_mean": 0.0249245073646307,
      "rotation_flip": 0.01159678865224123,
      "sparse_tokens": 20759.0,
      "step": 8368,
      "turn_loss": 0.21071705222129822,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3888217803382271,
      "grad_norm": 0.44225797057151794,
      "learning_rate": 2.13428441625602e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.007982416078448296,
      "mae_dx": 0.0019054773729294538,
      "mae_dy": 0.002336803125217557,
      "pose_mae_dtheta": 0.05553699657320976,
      "pose_mae_dx": 0.02217327244579792,
      "pose_mae_dy": 0.01825052686035633,
      "pose_rmse_dtheta": 0.174425408244133,
      "pose_rmse_dx": 0.05531388148665428,
      "pose_rmse_dy": 0.045125674456357956,
      "pose_rmse_mean": 0.09162165969610214,
      "rmse_dtheta": 0.022382918745279312,
      "rmse_dx": 0.004345267545431852,
      "rmse_dy": 0.005703875795006752,
      "rmse_mean": 0.010810688138008118,
      "rotation_flip": 0.002138579962775111,
      "sparse_tokens": 32169.0,
      "step": 8369,
      "turn_loss": 0.06987981498241425,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32438.0,
      "epoch": 0.3888682401040699,
      "grad_norm": 0.8893492221832275,
      "learning_rate": 2.1332010170119986e-06,
      "loss": 0.2393,
      "mae_dtheta": 0.03954698517918587,
      "mae_dx": 0.01153638120740652,
      "mae_dy": 0.006786422338336706,
      "pose_mae_dtheta": 0.2888512909412384,
      "pose_mae_dx": 0.09145789593458176,
      "pose_mae_dy": 0.05891415476799011,
      "pose_rmse_dtheta": 0.513642430305481,
      "pose_rmse_dx": 0.21453161537647247,
      "pose_rmse_dy": 0.13140031695365906,
      "pose_rmse_mean": 0.28652477264404297,
      "rmse_dtheta": 0.05925631895661354,
      "rmse_dx": 0.023561973124742508,
      "rmse_dy": 0.014585964381694794,
      "rmse_mean": 0.03246808797121048,
      "rotation_flip": 0.006338028237223625,
      "sparse_tokens": 26515.0,
      "step": 8370,
      "turn_loss": 0.2733955681324005,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 29432.0,
      "epoch": 0.3889146998699127,
      "grad_norm": 0.7534641623497009,
      "learning_rate": 2.132117818244771e-06,
      "loss": 0.1805,
      "mae_dtheta": 0.03231197968125343,
      "mae_dx": 0.012787303887307644,
      "mae_dy": 0.005427434109151363,
      "pose_mae_dtheta": 0.24929386377334595,
      "pose_mae_dx": 0.10000991076231003,
      "pose_mae_dy": 0.0690799430012703,
      "pose_rmse_dtheta": 0.44946473836898804,
      "pose_rmse_dx": 0.2228325754404068,
      "pose_rmse_dy": 0.16186116635799408,
      "pose_rmse_mean": 0.27805283665657043,
      "rmse_dtheta": 0.050738271325826645,
      "rmse_dx": 0.0250424575060606,
      "rmse_dy": 0.011897996999323368,
      "rmse_mean": 0.029226241633296013,
      "rotation_flip": 0.01536312885582447,
      "sparse_tokens": 24150.0,
      "step": 8371,
      "turn_loss": 0.3095504641532898,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.38896115963575545,
      "grad_norm": 0.5628028512001038,
      "learning_rate": 2.1310348200300816e-06,
      "loss": 0.097,
      "mae_dtheta": 0.010621966794133186,
      "mae_dx": 0.0021757774520665407,
      "mae_dy": 0.002659859601408243,
      "pose_mae_dtheta": 0.07631953060626984,
      "pose_mae_dx": 0.025335947051644325,
      "pose_mae_dy": 0.029253875836730003,
      "pose_rmse_dtheta": 0.16838915646076202,
      "pose_rmse_dx": 0.06488043814897537,
      "pose_rmse_dy": 0.06807580590248108,
      "pose_rmse_mean": 0.10044847428798676,
      "rmse_dtheta": 0.020967507734894753,
      "rmse_dx": 0.0063350750133395195,
      "rmse_dy": 0.005688650067895651,
      "rmse_mean": 0.010997077450156212,
      "rotation_flip": 0.006016847211867571,
      "sparse_tokens": 32089.0,
      "step": 8372,
      "turn_loss": 0.09285296499729156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3890076194015982,
      "grad_norm": 0.45937398076057434,
      "learning_rate": 2.1299520224436693e-06,
      "loss": 0.0737,
      "mae_dtheta": 0.010900060646235943,
      "mae_dx": 0.002673571230843663,
      "mae_dy": 0.0038539525121450424,
      "pose_mae_dtheta": 0.07431705296039581,
      "pose_mae_dx": 0.030360428616404533,
      "pose_mae_dy": 0.03876245766878128,
      "pose_rmse_dtheta": 0.20064516365528107,
      "pose_rmse_dx": 0.07717413455247879,
      "pose_rmse_dy": 0.12015973776578903,
      "pose_rmse_mean": 0.1326596885919571,
      "rmse_dtheta": 0.023843634873628616,
      "rmse_dx": 0.007053010165691376,
      "rmse_dy": 0.009196823462843895,
      "rmse_mean": 0.013364489190280437,
      "rotation_flip": 0.004894578363746405,
      "sparse_tokens": 32089.0,
      "step": 8373,
      "turn_loss": 0.10618873685598373,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.389054079167441,
      "grad_norm": 0.4714663028717041,
      "learning_rate": 2.1288694255612504e-06,
      "loss": 0.1095,
      "mae_dtheta": 0.014242502860724926,
      "mae_dx": 0.0019482930656522512,
      "mae_dy": 0.0020991191267967224,
      "pose_mae_dtheta": 0.10011643916368484,
      "pose_mae_dx": 0.022012969478964806,
      "pose_mae_dy": 0.024664869531989098,
      "pose_rmse_dtheta": 0.2841390073299408,
      "pose_rmse_dx": 0.059703484177589417,
      "pose_rmse_dy": 0.06357353925704956,
      "pose_rmse_mean": 0.13580535352230072,
      "rmse_dtheta": 0.03364523872733116,
      "rmse_dx": 0.005622413009405136,
      "rmse_dy": 0.00508939428254962,
      "rmse_mean": 0.014785682782530785,
      "rotation_flip": 0.002015316393226385,
      "sparse_tokens": 32137.0,
      "step": 8374,
      "turn_loss": 0.10474319010972977,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.3891005389332838,
      "grad_norm": 0.9257556200027466,
      "learning_rate": 2.1277870294585333e-06,
      "loss": 0.2,
      "mae_dtheta": 0.0352119617164135,
      "mae_dx": 0.007490659598261118,
      "mae_dy": 0.004186964128166437,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9257556200027466,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 148.39889526367188,
      "model/head/act_norm_mean": 103.95097155448718,
      "model/head/act_norm_min": 65.07696533203125,
      "model/head/act_over_embed": 71.43608085657237,
      "model/head/grad_frac": 0.10510258376598358,
      "model/head/grad_norm": 0.09729930758476257,
      "model/head/grad_zero_frac": 0.0002176484267693013,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6861227964743589,
      "model/head/update_ratio": 0.0016574179753661156,
      "model/head/weight_delta": 9.75905704498291,
      "model/head/weight_delta_rel": 0.17120276391506195,
      "model/head/weight_norm": 58.705352783203125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42237818241119385,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4223064422607422,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4222662150859833,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.290212940816786,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06392958015203476,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05918316915631294,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.544873046875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019111445872113109,
      "model/modality_embedder.encoders.pose/weight_delta": 3.114851951599121,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10177192091941833,
      "model/modality_embedder.encoders.pose/weight_norm": 30.967395782470703,
      "model/modality_embedder/grad_frac": 0.06392958015203476,
      "model/modality_embedder/grad_norm": 0.05918316915631294,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.544873046875,
      "model/modality_embedder/update_ratio": 0.0019111445872113109,
      "model/modality_embedder/weight_delta": 3.114851951599121,
      "model/modality_embedder/weight_delta_rel": 0.10177192091941833,
      "model/modality_embedder/weight_norm": 30.967395782470703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 70.39636993408203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.108910765160765,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.268566131591797,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.880659826849696,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08097042888402939,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.07495883107185364,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002683255122974515,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6290946006774902,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09580579400062561,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.93578338623047,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 71.99166870117188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.929827406389908,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.775026321411133,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.444801428245047,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08328937739133835,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07710561156272888,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0025935147423297167,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.333578109741211,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11547774821519852,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.730161666870117,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 73.67427062988281,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.589797644485145,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.074520111083984,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.58554851675031,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07618632912635803,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07052992284297943,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002297492465004325,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6052188873291016,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12105649709701538,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.698652267456055,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.95386505126953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.413655499593,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.764252662658691,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.838920710006693,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0765012577176094,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.07082147151231766,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0023668501526117325,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.091299533843994,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10564594715833664,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9222469329834,
      "model/normalizer/grad_frac": 0.28695112466812134,
      "model/normalizer/grad_norm": 0.2656466066837311,
      "model/normalizer/grad_zero_frac": 0.0002410746383247897,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0033791977912187576,
      "model/normalizer/weight_delta": 6.51823091506958,
      "model/normalizer/weight_delta_rel": 0.08395104110240936,
      "model/normalizer/weight_norm": 78.6123275756836,
      "pose_mae_dtheta": 0.2643185257911682,
      "pose_mae_dx": 0.05128388851881027,
      "pose_mae_dy": 0.053586967289447784,
      "pose_rmse_dtheta": 0.493180513381958,
      "pose_rmse_dx": 0.12053564935922623,
      "pose_rmse_dy": 0.13951058685779572,
      "pose_rmse_mean": 0.2510755956172943,
      "rmse_dtheta": 0.054783180356025696,
      "rmse_dx": 0.01743144728243351,
      "rmse_dy": 0.009334554895758629,
      "rmse_mean": 0.027183061465620995,
      "rotation_flip": 0.014173228293657303,
      "sparse_tokens": 10579.0,
      "step": 8375,
      "turn_loss": 0.221635103225708,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.38914699869912656,
      "grad_norm": 0.7097364664077759,
      "learning_rate": 2.1267048342112135e-06,
      "loss": 0.1903,
      "mae_dtheta": 0.024315834045410156,
      "mae_dx": 0.005758102051913738,
      "mae_dy": 0.003279847325757146,
      "pose_mae_dtheta": 0.18175196647644043,
      "pose_mae_dx": 0.039263609796762466,
      "pose_mae_dy": 0.035764794796705246,
      "pose_rmse_dtheta": 0.338943749666214,
      "pose_rmse_dx": 0.11536732316017151,
      "pose_rmse_dy": 0.09196443855762482,
      "pose_rmse_mean": 0.1820918321609497,
      "rmse_dtheta": 0.04285965859889984,
      "rmse_dx": 0.015500505454838276,
      "rmse_dy": 0.0077184345573186874,
      "rmse_mean": 0.022026199847459793,
      "rotation_flip": 0.005141388159245253,
      "sparse_tokens": 6911.0,
      "step": 8376,
      "turn_loss": 0.24857661128044128,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.38919345846496933,
      "grad_norm": 0.5951747894287109,
      "learning_rate": 2.125622839894964e-06,
      "loss": 0.1251,
      "mae_dtheta": 0.01023237593472004,
      "mae_dx": 0.0024059738498181105,
      "mae_dy": 0.0027549376245588064,
      "pose_mae_dtheta": 0.07186990231275558,
      "pose_mae_dx": 0.02394814044237137,
      "pose_mae_dy": 0.031241096556186676,
      "pose_rmse_dtheta": 0.17119108140468597,
      "pose_rmse_dx": 0.06362390518188477,
      "pose_rmse_dy": 0.08387161046266556,
      "pose_rmse_mean": 0.10622887313365936,
      "rmse_dtheta": 0.022739853709936142,
      "rmse_dx": 0.00766986608505249,
      "rmse_dy": 0.007137682288885117,
      "rmse_mean": 0.012515801005065441,
      "rotation_flip": 0.007792207878082991,
      "sparse_tokens": 32089.0,
      "step": 8377,
      "turn_loss": 0.10987420380115509,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3892399182308121,
      "grad_norm": 0.6731539368629456,
      "learning_rate": 2.124541046585455e-06,
      "loss": 0.1499,
      "mae_dtheta": 0.00816305261105299,
      "mae_dx": 0.0012234459863975644,
      "mae_dy": 0.0017276339931413531,
      "pose_mae_dtheta": 0.05412912741303444,
      "pose_mae_dx": 0.01507073175162077,
      "pose_mae_dy": 0.0217504370957613,
      "pose_rmse_dtheta": 0.1573052704334259,
      "pose_rmse_dx": 0.04182381555438042,
      "pose_rmse_dy": 0.05424882471561432,
      "pose_rmse_mean": 0.08445930480957031,
      "rmse_dtheta": 0.018757449463009834,
      "rmse_dx": 0.004083814565092325,
      "rmse_dy": 0.0040915971621870995,
      "rmse_mean": 0.008977620862424374,
      "rotation_flip": 0.002576212864369154,
      "sparse_tokens": 32057.0,
      "step": 8378,
      "turn_loss": 0.07371554523706436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3892863779966549,
      "grad_norm": 0.4237973988056183,
      "learning_rate": 2.1234594543583315e-06,
      "loss": 0.084,
      "mae_dtheta": 0.01032414473593235,
      "mae_dx": 0.002815373009070754,
      "mae_dy": 0.002816104795783758,
      "pose_mae_dtheta": 0.0762391909956932,
      "pose_mae_dx": 0.03148623928427696,
      "pose_mae_dy": 0.026978837326169014,
      "pose_rmse_dtheta": 0.20547348260879517,
      "pose_rmse_dx": 0.09710952639579773,
      "pose_rmse_dy": 0.06555579602718353,
      "pose_rmse_mean": 0.12271293252706528,
      "rmse_dtheta": 0.02434908226132393,
      "rmse_dx": 0.008831517770886421,
      "rmse_dy": 0.007764312904328108,
      "rmse_mean": 0.013648305088281631,
      "rotation_flip": 0.00932159461081028,
      "sparse_tokens": 32073.0,
      "step": 8379,
      "turn_loss": 0.09577076137065887,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.38933283776249766,
      "grad_norm": 1.0218322277069092,
      "learning_rate": 2.1223780632892337e-06,
      "loss": 0.1204,
      "mae_dtheta": 0.020378481596708298,
      "mae_dx": 0.005801819264888763,
      "mae_dy": 0.003934818785637617,
      "pose_mae_dtheta": 0.1476643830537796,
      "pose_mae_dx": 0.05756032094359398,
      "pose_mae_dy": 0.03757663443684578,
      "pose_rmse_dtheta": 0.2714248597621918,
      "pose_rmse_dx": 0.13476590812206268,
      "pose_rmse_dy": 0.08498566597700119,
      "pose_rmse_mean": 0.16372548043727875,
      "rmse_dtheta": 0.03876591846346855,
      "rmse_dx": 0.013184049166738987,
      "rmse_dy": 0.007798944134265184,
      "rmse_mean": 0.01991630345582962,
      "rotation_flip": 0.008510638028383255,
      "sparse_tokens": 3620.0,
      "step": 8380,
      "turn_loss": 0.18702615797519684,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 32015.0,
      "epoch": 0.38937929752834044,
      "grad_norm": 0.6010332107543945,
      "learning_rate": 2.1212968734537813e-06,
      "loss": 0.1782,
      "mae_dtheta": 0.033967047929763794,
      "mae_dx": 0.01032958459109068,
      "mae_dy": 0.005408765748143196,
      "pose_mae_dtheta": 0.2980652153491974,
      "pose_mae_dx": 0.09012697637081146,
      "pose_mae_dy": 0.07425182312726974,
      "pose_rmse_dtheta": 0.5084303617477417,
      "pose_rmse_dx": 0.1818380206823349,
      "pose_rmse_dy": 0.1564488559961319,
      "pose_rmse_mean": 0.28223907947540283,
      "rmse_dtheta": 0.05262621119618416,
      "rmse_dx": 0.021175093948841095,
      "rmse_dy": 0.010199089534580708,
      "rmse_mean": 0.028000134974718094,
      "rotation_flip": 0.009715993888676167,
      "sparse_tokens": 24757.0,
      "step": 8381,
      "turn_loss": 0.2568682134151459,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.3894257572941832,
      "grad_norm": 0.4681592583656311,
      "learning_rate": 2.1202158849275833e-06,
      "loss": 0.099,
      "mae_dtheta": 0.0303028617054224,
      "mae_dx": 0.009130336344242096,
      "mae_dy": 0.00406788382679224,
      "pose_mae_dtheta": 0.21889623999595642,
      "pose_mae_dx": 0.08813272416591644,
      "pose_mae_dy": 0.059493113309144974,
      "pose_rmse_dtheta": 0.383868932723999,
      "pose_rmse_dx": 0.19983282685279846,
      "pose_rmse_dy": 0.13355644047260284,
      "pose_rmse_mean": 0.2390860617160797,
      "rmse_dtheta": 0.04677276685833931,
      "rmse_dx": 0.021607492119073868,
      "rmse_dy": 0.00800650380551815,
      "rmse_mean": 0.025462254881858826,
      "rotation_flip": 0.0202312134206295,
      "sparse_tokens": 6999.0,
      "step": 8382,
      "turn_loss": 0.23026107251644135,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 23043.0,
      "epoch": 0.389472217060026,
      "grad_norm": 0.7546713948249817,
      "learning_rate": 2.1191350977862362e-06,
      "loss": 0.2051,
      "mae_dtheta": 0.024162668734788895,
      "mae_dx": 0.0076307617127895355,
      "mae_dy": 0.004382654093205929,
      "pose_mae_dtheta": 0.18854019045829773,
      "pose_mae_dx": 0.0800127238035202,
      "pose_mae_dy": 0.065162792801857,
      "pose_rmse_dtheta": 0.3497491776943207,
      "pose_rmse_dx": 0.18573811650276184,
      "pose_rmse_dy": 0.16268882155418396,
      "pose_rmse_mean": 0.2327253818511963,
      "rmse_dtheta": 0.04095891863107681,
      "rmse_dx": 0.01850051060318947,
      "rmse_dy": 0.008876574225723743,
      "rmse_mean": 0.022778667509555817,
      "rotation_flip": 0.015384615398943424,
      "sparse_tokens": 17377.0,
      "step": 8383,
      "turn_loss": 0.18135270476341248,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.38951867682586877,
      "grad_norm": 0.5883406400680542,
      "learning_rate": 2.1180545121053157e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.025009753182530403,
      "mae_dx": 0.0066806357353925705,
      "mae_dy": 0.0023564633447676897,
      "pose_mae_dtheta": 0.17733460664749146,
      "pose_mae_dx": 0.047163210809230804,
      "pose_mae_dy": 0.02105097658932209,
      "pose_rmse_dtheta": 0.31751134991645813,
      "pose_rmse_dx": 0.11117631942033768,
      "pose_rmse_dy": 0.06651127338409424,
      "pose_rmse_mean": 0.16506631672382355,
      "rmse_dtheta": 0.04289163649082184,
      "rmse_dx": 0.01773112826049328,
      "rmse_dy": 0.005204350687563419,
      "rmse_mean": 0.021942373365163803,
      "rotation_flip": 0.0143737168982625,
      "sparse_tokens": 7166.0,
      "step": 8384,
      "turn_loss": 0.1918264776468277,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.3895651365917116,
      "grad_norm": 0.6199819445610046,
      "learning_rate": 2.1169741279603927e-06,
      "loss": 0.185,
      "mae_dtheta": 0.03856223449110985,
      "mae_dx": 0.014508126303553581,
      "mae_dy": 0.004922711290419102,
      "pose_mae_dtheta": 0.32270318269729614,
      "pose_mae_dx": 0.10818850249052048,
      "pose_mae_dy": 0.0694534108042717,
      "pose_rmse_dtheta": 0.5537651181221008,
      "pose_rmse_dx": 0.24729959666728973,
      "pose_rmse_dy": 0.1761554777622223,
      "pose_rmse_mean": 0.3257400691509247,
      "rmse_dtheta": 0.058328017592430115,
      "rmse_dx": 0.027884602546691895,
      "rmse_dy": 0.011321697384119034,
      "rmse_mean": 0.03251143917441368,
      "rotation_flip": 0.009306260384619236,
      "sparse_tokens": 20498.0,
      "step": 8385,
      "turn_loss": 0.2673143744468689,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3896115963575544,
      "grad_norm": 0.5448508262634277,
      "learning_rate": 2.1158939454270138e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.009722349233925343,
      "mae_dx": 0.0010389601811766624,
      "mae_dy": 0.001887133694253862,
      "pose_mae_dtheta": 0.06599973887205124,
      "pose_mae_dx": 0.0160622950643301,
      "pose_mae_dy": 0.02707492932677269,
      "pose_rmse_dtheta": 0.16180799901485443,
      "pose_rmse_dx": 0.0429103747010231,
      "pose_rmse_dy": 0.06557021290063858,
      "pose_rmse_mean": 0.09009619802236557,
      "rmse_dtheta": 0.020994123071432114,
      "rmse_dx": 0.0033614160493016243,
      "rmse_dy": 0.0041322726756334305,
      "rmse_mean": 0.009495937265455723,
      "rotation_flip": 0.0023942538537085056,
      "sparse_tokens": 32057.0,
      "step": 8386,
      "turn_loss": 0.07489333301782608,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.38965805612339716,
      "grad_norm": 0.4130564033985138,
      "learning_rate": 2.1148139645807214e-06,
      "loss": 0.0816,
      "mae_dtheta": 0.006340849678963423,
      "mae_dx": 0.0012327171862125397,
      "mae_dy": 0.0001890419953269884,
      "pose_mae_dtheta": 0.03905827924609184,
      "pose_mae_dx": 0.009217407554388046,
      "pose_mae_dy": 0.002782149240374565,
      "pose_rmse_dtheta": 0.1735229641199112,
      "pose_rmse_dx": 0.020508185029029846,
      "pose_rmse_dy": 0.005369348917156458,
      "pose_rmse_mean": 0.06646683812141418,
      "rmse_dtheta": 0.02552056685090065,
      "rmse_dx": 0.0032023766543716192,
      "rmse_dy": 0.0003415619721636176,
      "rmse_mean": 0.00968816876411438,
      "rotation_flip": 0.0038046925328671932,
      "sparse_tokens": 32233.0,
      "step": 8387,
      "turn_loss": 0.037850745022296906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24341.0,
      "epoch": 0.38970451588923993,
      "grad_norm": 0.6127601265907288,
      "learning_rate": 2.113734185497035e-06,
      "loss": 0.171,
      "mae_dtheta": 0.02903062105178833,
      "mae_dx": 0.010499773547053337,
      "mae_dy": 0.0055360347032547,
      "pose_mae_dtheta": 0.226704403758049,
      "pose_mae_dx": 0.07920844107866287,
      "pose_mae_dy": 0.07102210819721222,
      "pose_rmse_dtheta": 0.4291372299194336,
      "pose_rmse_dx": 0.1922987699508667,
      "pose_rmse_dy": 0.17796440422534943,
      "pose_rmse_mean": 0.26646679639816284,
      "rmse_dtheta": 0.046545617282390594,
      "rmse_dx": 0.02224355936050415,
      "rmse_dy": 0.011436902917921543,
      "rmse_mean": 0.026742026209831238,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 19830.0,
      "step": 8388,
      "turn_loss": 0.236619234085083,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3897509756550827,
      "grad_norm": 0.5645503401756287,
      "learning_rate": 2.1126546082514665e-06,
      "loss": 0.1062,
      "mae_dtheta": 0.007343629840761423,
      "mae_dx": 0.0011107134632766247,
      "mae_dy": 0.0013795800041407347,
      "pose_mae_dtheta": 0.05472663789987564,
      "pose_mae_dx": 0.013304372318089008,
      "pose_mae_dy": 0.020711364224553108,
      "pose_rmse_dtheta": 0.1677793711423874,
      "pose_rmse_dx": 0.041729867458343506,
      "pose_rmse_dy": 0.05832800641655922,
      "pose_rmse_mean": 0.08927908539772034,
      "rmse_dtheta": 0.01911020465195179,
      "rmse_dx": 0.004034857731312513,
      "rmse_dy": 0.003821789054200053,
      "rmse_mean": 0.008988950401544571,
      "rotation_flip": 0.004611330572515726,
      "sparse_tokens": 32041.0,
      "step": 8389,
      "turn_loss": 0.05997074022889137,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3897974354209255,
      "grad_norm": 0.49381908774375916,
      "learning_rate": 2.111575232919513e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.009191739372909069,
      "mae_dx": 0.001853862195275724,
      "mae_dy": 0.002588375238701701,
      "pose_mae_dtheta": 0.06275581568479538,
      "pose_mae_dx": 0.02561122365295887,
      "pose_mae_dy": 0.023873228579759598,
      "pose_rmse_dtheta": 0.1755029261112213,
      "pose_rmse_dx": 0.07616878300905228,
      "pose_rmse_dy": 0.07464498281478882,
      "pose_rmse_mean": 0.10877223312854767,
      "rmse_dtheta": 0.023530209437012672,
      "rmse_dx": 0.005060696043074131,
      "rmse_dy": 0.006866466719657183,
      "rmse_mean": 0.011819124221801758,
      "rotation_flip": 0.0065065063536167145,
      "sparse_tokens": 32121.0,
      "step": 8390,
      "turn_loss": 0.07848092168569565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.38984389518676826,
      "grad_norm": 0.5565184354782104,
      "learning_rate": 2.110496059576651e-06,
      "loss": 0.1018,
      "mae_dtheta": 0.01009924802929163,
      "mae_dx": 0.0014024832053110003,
      "mae_dy": 0.0014238699804991484,
      "pose_mae_dtheta": 0.06485114246606827,
      "pose_mae_dx": 0.015405630692839622,
      "pose_mae_dy": 0.02072541043162346,
      "pose_rmse_dtheta": 0.17392800748348236,
      "pose_rmse_dx": 0.03409360721707344,
      "pose_rmse_dy": 0.057785116136074066,
      "pose_rmse_mean": 0.08860224485397339,
      "rmse_dtheta": 0.02464240789413452,
      "rmse_dx": 0.004092659335583448,
      "rmse_dy": 0.002964267274364829,
      "rmse_mean": 0.01056644506752491,
      "rotation_flip": 0.00321802101098001,
      "sparse_tokens": 32153.0,
      "step": 8391,
      "turn_loss": 0.07003602385520935,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.38989035495261104,
      "grad_norm": 0.44014811515808105,
      "learning_rate": 2.1094170882983528e-06,
      "loss": 0.0554,
      "mae_dtheta": 0.008674136362969875,
      "mae_dx": 0.0017089046305045485,
      "mae_dy": 0.0024910641368478537,
      "pose_mae_dtheta": 0.06382619589567184,
      "pose_mae_dx": 0.02465697005391121,
      "pose_mae_dy": 0.026975153014063835,
      "pose_rmse_dtheta": 0.18517912924289703,
      "pose_rmse_dx": 0.07610204070806503,
      "pose_rmse_dy": 0.1106511726975441,
      "pose_rmse_mean": 0.12397744506597519,
      "rmse_dtheta": 0.022366447374224663,
      "rmse_dx": 0.0044271755032241344,
      "rmse_dy": 0.007045709528028965,
      "rmse_mean": 0.011279778555035591,
      "rotation_flip": 0.007955077104270458,
      "sparse_tokens": 32121.0,
      "step": 8392,
      "turn_loss": 0.06970684975385666,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3899368147184538,
      "grad_norm": 0.4477996230125427,
      "learning_rate": 2.1083383191600676e-06,
      "loss": 0.0975,
      "mae_dtheta": 0.008251151069998741,
      "mae_dx": 0.001600349904038012,
      "mae_dy": 0.0018345671705901623,
      "pose_mae_dtheta": 0.056139346212148666,
      "pose_mae_dx": 0.017622889950871468,
      "pose_mae_dy": 0.01978343538939953,
      "pose_rmse_dtheta": 0.1422172337770462,
      "pose_rmse_dx": 0.04630817100405693,
      "pose_rmse_dy": 0.047955289483070374,
      "pose_rmse_mean": 0.078826904296875,
      "rmse_dtheta": 0.01897602528333664,
      "rmse_dx": 0.005311326123774052,
      "rmse_dy": 0.0038811462000012398,
      "rmse_mean": 0.009389499202370644,
      "rotation_flip": 0.0060889930464327335,
      "sparse_tokens": 32089.0,
      "step": 8393,
      "turn_loss": 0.06825848668813705,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.3899832744842966,
      "grad_norm": 0.4511483609676361,
      "learning_rate": 2.107259752237235e-06,
      "loss": 0.1001,
      "mae_dtheta": 0.017532045021653175,
      "mae_dx": 0.005103885196149349,
      "mae_dy": 0.0030521531589329243,
      "pose_mae_dtheta": 0.12863776087760925,
      "pose_mae_dx": 0.04791703447699547,
      "pose_mae_dy": 0.04081101715564728,
      "pose_rmse_dtheta": 0.2653585970401764,
      "pose_rmse_dx": 0.1267952024936676,
      "pose_rmse_dy": 0.10326292365789413,
      "pose_rmse_mean": 0.16513891518115997,
      "rmse_dtheta": 0.03210684284567833,
      "rmse_dx": 0.014616316184401512,
      "rmse_dy": 0.006425030063837767,
      "rmse_mean": 0.0177160631865263,
      "rotation_flip": 0.012569832615554333,
      "sparse_tokens": 16059.0,
      "step": 8394,
      "turn_loss": 0.1412651389837265,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.39002973425013937,
      "grad_norm": 0.45849090814590454,
      "learning_rate": 2.106181387605283e-06,
      "loss": 0.1052,
      "mae_dtheta": 0.008782196789979935,
      "mae_dx": 0.001336262677796185,
      "mae_dy": 0.002216112334281206,
      "pose_mae_dtheta": 0.05727497860789299,
      "pose_mae_dx": 0.019717436283826828,
      "pose_mae_dy": 0.028667079284787178,
      "pose_rmse_dtheta": 0.15611019730567932,
      "pose_rmse_dx": 0.052911896258592606,
      "pose_rmse_dy": 0.07435917109251022,
      "pose_rmse_mean": 0.09446042031049728,
      "rmse_dtheta": 0.019067101180553436,
      "rmse_dx": 0.0040733953937888145,
      "rmse_dy": 0.005257318262010813,
      "rmse_mean": 0.009465938434004784,
      "rotation_flip": 0.00551782688125968,
      "sparse_tokens": 32073.0,
      "step": 8395,
      "turn_loss": 0.06947609782218933,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.39007619401598215,
      "grad_norm": 0.5209230184555054,
      "learning_rate": 2.105103225339618e-06,
      "loss": 0.1237,
      "mae_dtheta": 0.009893027134239674,
      "mae_dx": 0.0016730980714783072,
      "mae_dy": 0.0016606077551841736,
      "pose_mae_dtheta": 0.07263083010911942,
      "pose_mae_dx": 0.018021559342741966,
      "pose_mae_dy": 0.02005939558148384,
      "pose_rmse_dtheta": 0.2421242892742157,
      "pose_rmse_dx": 0.058337047696113586,
      "pose_rmse_dy": 0.060511428862810135,
      "pose_rmse_mean": 0.1203242689371109,
      "rmse_dtheta": 0.026933271437883377,
      "rmse_dx": 0.006406101863831282,
      "rmse_dy": 0.0046278066001832485,
      "rmse_mean": 0.012655726633965969,
      "rotation_flip": 0.0021356113720685244,
      "sparse_tokens": 32041.0,
      "step": 8396,
      "turn_loss": 0.05789484456181526,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3901226537818249,
      "grad_norm": 0.5209455490112305,
      "learning_rate": 2.10402526551564e-06,
      "loss": 0.135,
      "mae_dtheta": 0.01251405943185091,
      "mae_dx": 0.0020441156812012196,
      "mae_dy": 0.00309889973141253,
      "pose_mae_dtheta": 0.0849294513463974,
      "pose_mae_dx": 0.027274882420897484,
      "pose_mae_dy": 0.03345118835568428,
      "pose_rmse_dtheta": 0.2146035134792328,
      "pose_rmse_dx": 0.06860123574733734,
      "pose_rmse_dy": 0.08206220716238022,
      "pose_rmse_mean": 0.12175565212965012,
      "rmse_dtheta": 0.027090558782219887,
      "rmse_dx": 0.006186523474752903,
      "rmse_dy": 0.006843749899417162,
      "rmse_mean": 0.013373611494898796,
      "rotation_flip": 0.004442798905074596,
      "sparse_tokens": 32073.0,
      "step": 8397,
      "turn_loss": 0.1043970137834549,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.3901691135476677,
      "grad_norm": 0.42946672439575195,
      "learning_rate": 2.1029475082087273e-06,
      "loss": 0.1107,
      "mae_dtheta": 0.03199160099029541,
      "mae_dx": 0.008618064224720001,
      "mae_dy": 0.003283979371190071,
      "pose_mae_dtheta": 0.2515546977519989,
      "pose_mae_dx": 0.06890953332185745,
      "pose_mae_dy": 0.0394277386367321,
      "pose_rmse_dtheta": 0.4459630250930786,
      "pose_rmse_dx": 0.14847253262996674,
      "pose_rmse_dy": 0.08377822488546371,
      "pose_rmse_mean": 0.22607126832008362,
      "rmse_dtheta": 0.050786055624485016,
      "rmse_dx": 0.019327504560351372,
      "rmse_dy": 0.006610655691474676,
      "rmse_mean": 0.025574740022420883,
      "rotation_flip": 0.008964143693447113,
      "sparse_tokens": 15273.0,
      "step": 8398,
      "turn_loss": 0.23158952593803406,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3902155733135105,
      "grad_norm": 0.4987683892250061,
      "learning_rate": 2.1018699534942525e-06,
      "loss": 0.0916,
      "mae_dtheta": 0.00970703735947609,
      "mae_dx": 0.000998750445432961,
      "mae_dy": 0.0017973246285691857,
      "pose_mae_dtheta": 0.06445670872926712,
      "pose_mae_dx": 0.01580531895160675,
      "pose_mae_dy": 0.023786747828125954,
      "pose_rmse_dtheta": 0.18143340945243835,
      "pose_rmse_dx": 0.041188620030879974,
      "pose_rmse_dy": 0.0547698512673378,
      "pose_rmse_mean": 0.09246396273374557,
      "rmse_dtheta": 0.022042136639356613,
      "rmse_dx": 0.003147844225168228,
      "rmse_dy": 0.003816578071564436,
      "rmse_mean": 0.009668853133916855,
      "rotation_flip": 0.0047095762565732,
      "sparse_tokens": 32057.0,
      "step": 8399,
      "turn_loss": 0.07207909226417542,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.39026203307935325,
      "grad_norm": 0.6516349911689758,
      "learning_rate": 2.1007926014475655e-06,
      "loss": 0.1012,
      "mae_dtheta": 0.042486075311899185,
      "mae_dx": 0.011025055311620235,
      "mae_dy": 0.006444575265049934,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6516349911689758,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 134.7100067138672,
      "model/head/act_norm_mean": 106.5001220703125,
      "model/head/act_norm_min": 83.4864273071289,
      "model/head/act_over_embed": 73.18788095657067,
      "model/head/grad_frac": 0.10423284024000168,
      "model/head/grad_norm": 0.06792176514863968,
      "model/head/grad_zero_frac": 0.00010565150296315551,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.70263671875,
      "model/head/update_ratio": 0.001156973885372281,
      "model/head/weight_delta": 9.763854026794434,
      "model/head/weight_delta_rel": 0.1712869256734848,
      "model/head/weight_norm": 58.70639419555664,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4222462773323059,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222462773323059,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4222462773323059,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29017159491469163,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09726420789957047,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06338076293468475,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0020466800779104233,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1168668270111084,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10183775424957275,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96759605407715,
      "model/modality_embedder/grad_frac": 0.09726420789957047,
      "model/modality_embedder/grad_norm": 0.06338076293468475,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0020466800779104233,
      "model/modality_embedder/weight_delta": 3.1168668270111084,
      "model/modality_embedder/weight_delta_rel": 0.10183775424957275,
      "model/modality_embedder/weight_norm": 30.96759605407715,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 69.30621337890625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.390011160714284,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.18523120880127,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.07383465037744,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06067041680216789,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03953496739268303,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014151817886158824,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6312437057495117,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09588410705327988,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.936317443847656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 69.9846420288086,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.16801525297619,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.986695289611816,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.608486346368892,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07249816507101059,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04724234342575073,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 9.582795610185713e-05,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015890061622485518,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.336158514022827,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11556714028120041,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.730749130249023,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 71.6331558227539,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.791655815972224,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.589905738830566,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.72426734202221,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07712525874376297,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.050257518887519836,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001637087669223547,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6083297729492188,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12116095423698425,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.699344635009766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 71.59727478027344,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.694959077380954,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.387072563171387,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.032235162268165,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08269771188497543,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.053888723254203796,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018009376944974065,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0939412117004395,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10573622584342957,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.922592163085938,
      "model/normalizer/grad_frac": 0.3145599961280823,
      "model/normalizer/grad_norm": 0.20497830212116241,
      "model/normalizer/grad_zero_frac": 0.00011581036233110353,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0026074349880218506,
      "model/normalizer/weight_delta": 6.523704528808594,
      "model/normalizer/weight_delta_rel": 0.08402153849601746,
      "model/normalizer/weight_norm": 78.61300659179688,
      "pose_mae_dtheta": 0.3244422972202301,
      "pose_mae_dx": 0.10490114986896515,
      "pose_mae_dy": 0.052008822560310364,
      "pose_rmse_dtheta": 0.4865039885044098,
      "pose_rmse_dx": 0.21683120727539062,
      "pose_rmse_dy": 0.11056292057037354,
      "pose_rmse_mean": 0.2712993621826172,
      "rmse_dtheta": 0.058500222861766815,
      "rmse_dx": 0.020721618086099625,
      "rmse_dy": 0.01281194668263197,
      "rmse_mean": 0.030677929520606995,
      "rotation_flip": 0.036764707416296005,
      "sparse_tokens": 2671.0,
      "step": 8400,
      "turn_loss": 0.27868205308914185,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "epoch": 0.39026203307935325,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30587276816368103,
      "eval_objectnav_nopose_mae_dtheta": 0.0397658571600914,
      "eval_objectnav_nopose_mae_dx": 0.013433726504445076,
      "eval_objectnav_nopose_mae_dy": 0.00501948082819581,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3205682635307312,
      "eval_objectnav_nopose_pose_mae_dx": 0.10839740186929703,
      "eval_objectnav_nopose_pose_mae_dy": 0.057085711508989334,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5434251427650452,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23648834228515625,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13424403965473175,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3047191798686981,
      "eval_objectnav_nopose_rmse_dtheta": 0.05756771191954613,
      "eval_objectnav_nopose_rmse_dx": 0.026195095852017403,
      "eval_objectnav_nopose_rmse_dy": 0.010210106149315834,
      "eval_objectnav_nopose_rmse_mean": 0.03132430464029312,
      "eval_objectnav_nopose_rotation_flip": 0.01389604713767767,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30587276816368103,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 8400
    },
    {
      "epoch": 0.39026203307935325,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2769578993320465,
      "eval_objectnav_pose_mae_dtheta": 0.03569263592362404,
      "eval_objectnav_pose_mae_dx": 0.011370573192834854,
      "eval_objectnav_pose_mae_dy": 0.004744863603264093,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26851171255111694,
      "eval_objectnav_pose_pose_mae_dx": 0.08893381804227829,
      "eval_objectnav_pose_pose_mae_dy": 0.04980432242155075,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4811602234840393,
      "eval_objectnav_pose_pose_rmse_dx": 0.20852933824062347,
      "eval_objectnav_pose_pose_rmse_dy": 0.11975947767496109,
      "eval_objectnav_pose_pose_rmse_mean": 0.2698163688182831,
      "eval_objectnav_pose_rmse_dtheta": 0.05401785299181938,
      "eval_objectnav_pose_rmse_dx": 0.02374381199479103,
      "eval_objectnav_pose_rmse_dy": 0.010007739998400211,
      "eval_objectnav_pose_rmse_mean": 0.029256468638777733,
      "eval_objectnav_pose_rotation_flip": 0.014301234856247902,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2769578993320465,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 8400
    },
    {
      "epoch": 0.39026203307935325,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08938441425561905,
      "eval_pointnav_mae_dtheta": 0.010180327109992504,
      "eval_pointnav_mae_dx": 0.002299305982887745,
      "eval_pointnav_mae_dy": 0.0023423833772540092,
      "eval_pointnav_pose_mae_dtheta": 0.07000759989023209,
      "eval_pointnav_pose_mae_dx": 0.025451602414250374,
      "eval_pointnav_pose_mae_dy": 0.024850131943821907,
      "eval_pointnav_pose_rmse_dtheta": 0.20404265820980072,
      "eval_pointnav_pose_rmse_dx": 0.07885438203811646,
      "eval_pointnav_pose_rmse_dy": 0.07271351665258408,
      "eval_pointnav_pose_rmse_mean": 0.11853685975074768,
      "eval_pointnav_rmse_dtheta": 0.025415655225515366,
      "eval_pointnav_rmse_dx": 0.0074135856702923775,
      "eval_pointnav_rmse_dy": 0.006428959779441357,
      "eval_pointnav_rmse_mean": 0.013086067512631416,
      "eval_pointnav_rotation_flip": 0.005397756118327379,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08938441425561905,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 8400
    },
    {
      "epoch": 0.39026203307935325,
      "eval_loss": 0.22407169391711554,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30587276816368103,
      "eval_objectnav_nopose_mae_dtheta": 0.0397658571600914,
      "eval_objectnav_nopose_mae_dx": 0.013433726504445076,
      "eval_objectnav_nopose_mae_dy": 0.00501948082819581,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3205682635307312,
      "eval_objectnav_nopose_pose_mae_dx": 0.10839740186929703,
      "eval_objectnav_nopose_pose_mae_dy": 0.057085711508989334,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5434251427650452,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23648834228515625,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13424403965473175,
      "eval_objectnav_nopose_pose_rmse_mean": 0.3047191798686981,
      "eval_objectnav_nopose_rmse_dtheta": 0.05756771191954613,
      "eval_objectnav_nopose_rmse_dx": 0.026195095852017403,
      "eval_objectnav_nopose_rmse_dy": 0.010210106149315834,
      "eval_objectnav_nopose_rmse_mean": 0.03132430464029312,
      "eval_objectnav_nopose_rotation_flip": 0.01389604713767767,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30587276816368103,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2769578993320465,
      "eval_objectnav_pose_mae_dtheta": 0.03569263592362404,
      "eval_objectnav_pose_mae_dx": 0.011370573192834854,
      "eval_objectnav_pose_mae_dy": 0.004744863603264093,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26851171255111694,
      "eval_objectnav_pose_pose_mae_dx": 0.08893381804227829,
      "eval_objectnav_pose_pose_mae_dy": 0.04980432242155075,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4811602234840393,
      "eval_objectnav_pose_pose_rmse_dx": 0.20852933824062347,
      "eval_objectnav_pose_pose_rmse_dy": 0.11975947767496109,
      "eval_objectnav_pose_pose_rmse_mean": 0.2698163688182831,
      "eval_objectnav_pose_rmse_dtheta": 0.05401785299181938,
      "eval_objectnav_pose_rmse_dx": 0.02374381199479103,
      "eval_objectnav_pose_rmse_dy": 0.010007739998400211,
      "eval_objectnav_pose_rmse_mean": 0.029256468638777733,
      "eval_objectnav_pose_rotation_flip": 0.014301234856247902,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2769578993320465,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08938441425561905,
      "eval_pointnav_mae_dtheta": 0.010180327109992504,
      "eval_pointnav_mae_dx": 0.002299305982887745,
      "eval_pointnav_mae_dy": 0.0023423833772540092,
      "eval_pointnav_pose_mae_dtheta": 0.07000759989023209,
      "eval_pointnav_pose_mae_dx": 0.025451602414250374,
      "eval_pointnav_pose_mae_dy": 0.024850131943821907,
      "eval_pointnav_pose_rmse_dtheta": 0.20404265820980072,
      "eval_pointnav_pose_rmse_dx": 0.07885438203811646,
      "eval_pointnav_pose_rmse_dy": 0.07271351665258408,
      "eval_pointnav_pose_rmse_mean": 0.11853685975074768,
      "eval_pointnav_rmse_dtheta": 0.025415655225515366,
      "eval_pointnav_rmse_dx": 0.0074135856702923775,
      "eval_pointnav_rmse_dy": 0.006428959779441357,
      "eval_pointnav_rmse_mean": 0.013086067512631416,
      "eval_pointnav_rotation_flip": 0.005397756118327379,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08938441425561905,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 8400
    },
    {
      "dense_tokens": 31790.0,
      "epoch": 0.3903084928451961,
      "grad_norm": 0.7256157398223877,
      "learning_rate": 2.09971545214401e-06,
      "loss": 0.1734,
      "mae_dtheta": 0.03066023625433445,
      "mae_dx": 0.010009288787841797,
      "mae_dy": 0.004012769553810358,
      "pose_mae_dtheta": 0.22535288333892822,
      "pose_mae_dx": 0.07798567414283752,
      "pose_mae_dy": 0.04950416833162308,
      "pose_rmse_dtheta": 0.43291622400283813,
      "pose_rmse_dx": 0.19685809314250946,
      "pose_rmse_dy": 0.12782278656959534,
      "pose_rmse_mean": 0.25253236293792725,
      "rmse_dtheta": 0.05008232221007347,
      "rmse_dx": 0.022632505744695663,
      "rmse_dy": 0.008476306684315205,
      "rmse_mean": 0.02706371247768402,
      "rotation_flip": 0.016540316864848137,
      "sparse_tokens": 26258.0,
      "step": 8401,
      "turn_loss": 0.2567017078399658,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.39035495261103886,
      "grad_norm": 1.3288127183914185,
      "learning_rate": 2.0986385056589077e-06,
      "loss": 0.2345,
      "mae_dtheta": 0.0327039435505867,
      "mae_dx": 0.020426921546459198,
      "mae_dy": 0.00681820884346962,
      "pose_mae_dtheta": 0.2255471646785736,
      "pose_mae_dx": 0.16378501057624817,
      "pose_mae_dy": 0.07894162833690643,
      "pose_rmse_dtheta": 0.3467363715171814,
      "pose_rmse_dx": 0.29359856247901917,
      "pose_rmse_dy": 0.18614952266216278,
      "pose_rmse_mean": 0.27549484372138977,
      "rmse_dtheta": 0.04518774151802063,
      "rmse_dx": 0.03333597257733345,
      "rmse_dy": 0.014869686216115952,
      "rmse_mean": 0.031131133437156677,
      "rotation_flip": 0.02087286487221718,
      "sparse_tokens": 8669.0,
      "step": 8402,
      "turn_loss": 0.3383919894695282,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.39040141237688164,
      "grad_norm": 0.6205217242240906,
      "learning_rate": 2.097561762067573e-06,
      "loss": 0.148,
      "mae_dtheta": 0.009228181093931198,
      "mae_dx": 0.001983069349080324,
      "mae_dy": 0.0019325822358950973,
      "pose_mae_dtheta": 0.06104940548539162,
      "pose_mae_dx": 0.018889134749770164,
      "pose_mae_dy": 0.020935028791427612,
      "pose_rmse_dtheta": 0.16339153051376343,
      "pose_rmse_dx": 0.05476429685950279,
      "pose_rmse_dy": 0.05025617405772209,
      "pose_rmse_mean": 0.08947066962718964,
      "rmse_dtheta": 0.022612087428569794,
      "rmse_dx": 0.006359899416565895,
      "rmse_dy": 0.005561948753893375,
      "rmse_mean": 0.011511312797665596,
      "rotation_flip": 0.005879471078515053,
      "sparse_tokens": 32121.0,
      "step": 8403,
      "turn_loss": 0.07959839701652527,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3904478721427244,
      "grad_norm": 0.47794485092163086,
      "learning_rate": 2.096485221445301e-06,
      "loss": 0.0714,
      "mae_dtheta": 0.009597408585250378,
      "mae_dx": 0.0015625727828592062,
      "mae_dy": 0.0021642297506332397,
      "pose_mae_dtheta": 0.0654274970293045,
      "pose_mae_dx": 0.018357258290052414,
      "pose_mae_dy": 0.026808682829141617,
      "pose_rmse_dtheta": 0.1584070771932602,
      "pose_rmse_dx": 0.04745854437351227,
      "pose_rmse_dy": 0.06196829304099083,
      "pose_rmse_mean": 0.0892779752612114,
      "rmse_dtheta": 0.02065473608672619,
      "rmse_dx": 0.004398163408041,
      "rmse_dy": 0.004595282021909952,
      "rmse_mean": 0.009882727637887001,
      "rotation_flip": 0.0029950083699077368,
      "sparse_tokens": 32153.0,
      "step": 8404,
      "turn_loss": 0.07376153767108917,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3904943319085672,
      "grad_norm": 0.3985528349876404,
      "learning_rate": 2.0954088838673783e-06,
      "loss": 0.0883,
      "mae_dtheta": 0.00408949563279748,
      "mae_dx": 0.001890672603622079,
      "mae_dy": 0.0002662886108737439,
      "pose_mae_dtheta": 0.02791501022875309,
      "pose_mae_dx": 0.015929725021123886,
      "pose_mae_dy": 0.0033891184721142054,
      "pose_rmse_dtheta": 0.14041398465633392,
      "pose_rmse_dx": 0.08529631793498993,
      "pose_rmse_dy": 0.01056002452969551,
      "pose_rmse_mean": 0.07875677943229675,
      "rmse_dtheta": 0.018908631056547165,
      "rmse_dx": 0.008588900789618492,
      "rmse_dy": 0.0007394531858153641,
      "rmse_mean": 0.009412328712642193,
      "rotation_flip": 0.0,
      "sparse_tokens": 32153.0,
      "step": 8405,
      "turn_loss": 0.05053138732910156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.39054079167440997,
      "grad_norm": 0.579383909702301,
      "learning_rate": 2.0943327494090687e-06,
      "loss": 0.1285,
      "mae_dtheta": 0.029842732474207878,
      "mae_dx": 0.010212467052042484,
      "mae_dy": 0.005329670384526253,
      "pose_mae_dtheta": 0.21640779078006744,
      "pose_mae_dx": 0.09234708547592163,
      "pose_mae_dy": 0.0690990686416626,
      "pose_rmse_dtheta": 0.41361603140830994,
      "pose_rmse_dx": 0.2088053822517395,
      "pose_rmse_dy": 0.12969651818275452,
      "pose_rmse_mean": 0.2507059574127197,
      "rmse_dtheta": 0.046827495098114014,
      "rmse_dx": 0.02194146066904068,
      "rmse_dy": 0.009286470711231232,
      "rmse_mean": 0.026018476113677025,
      "rotation_flip": 0.009247027337551117,
      "sparse_tokens": 12939.0,
      "step": 8406,
      "turn_loss": 0.2895180881023407,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.39058725144025275,
      "grad_norm": 0.3867270350456238,
      "learning_rate": 2.0932568181456314e-06,
      "loss": 0.0848,
      "mae_dtheta": 0.0087615130469203,
      "mae_dx": 0.001440223422832787,
      "mae_dy": 0.0017336937598884106,
      "pose_mae_dtheta": 0.05734426528215408,
      "pose_mae_dx": 0.016393370926380157,
      "pose_mae_dy": 0.020652813836932182,
      "pose_rmse_dtheta": 0.13599465787410736,
      "pose_rmse_dx": 0.04506105184555054,
      "pose_rmse_dy": 0.048491306602954865,
      "pose_rmse_mean": 0.07651567459106445,
      "rmse_dtheta": 0.018296802416443825,
      "rmse_dx": 0.004571393597871065,
      "rmse_dy": 0.0037595403846353292,
      "rmse_mean": 0.008875912055373192,
      "rotation_flip": 0.003619254333898425,
      "sparse_tokens": 32137.0,
      "step": 8407,
      "turn_loss": 0.06532040983438492,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3906337112060955,
      "grad_norm": 0.4732442796230316,
      "learning_rate": 2.092181090152303e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.007993658073246479,
      "mae_dx": 0.0010524924146011472,
      "mae_dy": 0.0012667556293308735,
      "pose_mae_dtheta": 0.047538258135318756,
      "pose_mae_dx": 0.011334751732647419,
      "pose_mae_dy": 0.012493261136114597,
      "pose_rmse_dtheta": 0.16364504396915436,
      "pose_rmse_dx": 0.031024431809782982,
      "pose_rmse_dy": 0.02948150783777237,
      "pose_rmse_mean": 0.07471700012683868,
      "rmse_dtheta": 0.02236665040254593,
      "rmse_dx": 0.0030984519980847836,
      "rmse_dy": 0.0031640196684747934,
      "rmse_mean": 0.00954304076731205,
      "rotation_flip": 0.0036866359878331423,
      "sparse_tokens": 32105.0,
      "step": 8408,
      "turn_loss": 0.05589080601930618,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.3906801709719383,
      "grad_norm": 1.0036072731018066,
      "learning_rate": 2.091105565504314e-06,
      "loss": 0.1986,
      "mae_dtheta": 0.034787777811288834,
      "mae_dx": 0.012572442181408405,
      "mae_dy": 0.0060025486163794994,
      "pose_mae_dtheta": 0.21631832420825958,
      "pose_mae_dx": 0.10906529426574707,
      "pose_mae_dy": 0.056625593453645706,
      "pose_rmse_dtheta": 0.3954404294490814,
      "pose_rmse_dx": 0.2404664307832718,
      "pose_rmse_dy": 0.16030606627464294,
      "pose_rmse_mean": 0.2654043138027191,
      "rmse_dtheta": 0.05481122434139252,
      "rmse_dx": 0.024679986760020256,
      "rmse_dy": 0.014930971898138523,
      "rmse_mean": 0.03147406131029129,
      "rotation_flip": 0.015915120020508766,
      "sparse_tokens": 7287.0,
      "step": 8409,
      "turn_loss": 0.29833322763442993,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 39144.0,
      "epoch": 0.3907266307377811,
      "grad_norm": 0.4562043845653534,
      "learning_rate": 2.0900302442768717e-06,
      "loss": 0.119,
      "mae_dtheta": 0.04084309563040733,
      "mae_dx": 0.013366158120334148,
      "mae_dy": 0.004574510268867016,
      "pose_mae_dtheta": 0.35102272033691406,
      "pose_mae_dx": 0.11650878936052322,
      "pose_mae_dy": 0.05120566487312317,
      "pose_rmse_dtheta": 0.5464085340499878,
      "pose_rmse_dx": 0.2361287772655487,
      "pose_rmse_dy": 0.12830504775047302,
      "pose_rmse_mean": 0.30361413955688477,
      "rmse_dtheta": 0.05578635632991791,
      "rmse_dx": 0.025087492540478706,
      "rmse_dy": 0.010462628677487373,
      "rmse_mean": 0.030445491895079613,
      "rotation_flip": 0.010482179932296276,
      "sparse_tokens": 28076.0,
      "step": 8410,
      "turn_loss": 0.3433056175708771,
      "turns": 121.0,
      "turns_per_sample": 121.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.39077309050362385,
      "grad_norm": 0.5984839200973511,
      "learning_rate": 2.0889551265451787e-06,
      "loss": 0.1262,
      "mae_dtheta": 0.00821584090590477,
      "mae_dx": 0.0021124708000570536,
      "mae_dy": 0.0015727583086118102,
      "pose_mae_dtheta": 0.0579911433160305,
      "pose_mae_dx": 0.01951548643410206,
      "pose_mae_dy": 0.018098963424563408,
      "pose_rmse_dtheta": 0.19484661519527435,
      "pose_rmse_dx": 0.058913107961416245,
      "pose_rmse_dy": 0.08525827527046204,
      "pose_rmse_mean": 0.11300599575042725,
      "rmse_dtheta": 0.02362181805074215,
      "rmse_dx": 0.0066003319807350636,
      "rmse_dy": 0.005552640184760094,
      "rmse_mean": 0.011924929916858673,
      "rotation_flip": 0.00690087815746665,
      "sparse_tokens": 32105.0,
      "step": 8411,
      "turn_loss": 0.06686771661043167,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.39081955026946663,
      "grad_norm": 0.3502664864063263,
      "learning_rate": 2.0878802123844138e-06,
      "loss": 0.0897,
      "mae_dtheta": 0.007303339894860983,
      "mae_dx": 0.0013346730265766382,
      "mae_dy": 0.0015200889902189374,
      "pose_mae_dtheta": 0.04936227202415466,
      "pose_mae_dx": 0.015701303258538246,
      "pose_mae_dy": 0.018621938303112984,
      "pose_rmse_dtheta": 0.12671951949596405,
      "pose_rmse_dx": 0.0369231253862381,
      "pose_rmse_dy": 0.04524894431233406,
      "pose_rmse_mean": 0.06963053345680237,
      "rmse_dtheta": 0.017919084057211876,
      "rmse_dx": 0.0037824406754225492,
      "rmse_dy": 0.0034892249386757612,
      "rmse_mean": 0.008396916091442108,
      "rotation_flip": 0.0034542314242571592,
      "sparse_tokens": 32153.0,
      "step": 8412,
      "turn_loss": 0.06232846528291702,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37315.0,
      "epoch": 0.3908660100353094,
      "grad_norm": 0.7386367321014404,
      "learning_rate": 2.086805501869749e-06,
      "loss": 0.2186,
      "mae_dtheta": 0.02540537528693676,
      "mae_dx": 0.008813169784843922,
      "mae_dy": 0.005031259264796972,
      "pose_mae_dtheta": 0.1844741404056549,
      "pose_mae_dx": 0.0724814161658287,
      "pose_mae_dy": 0.053556349128484726,
      "pose_rmse_dtheta": 0.3430827260017395,
      "pose_rmse_dx": 0.15749749541282654,
      "pose_rmse_dy": 0.12712927162647247,
      "pose_rmse_mean": 0.2092364877462387,
      "rmse_dtheta": 0.041689347475767136,
      "rmse_dx": 0.019429998472332954,
      "rmse_dy": 0.009997149929404259,
      "rmse_mean": 0.02370550110936165,
      "rotation_flip": 0.012763596139848232,
      "sparse_tokens": 29815.0,
      "step": 8413,
      "turn_loss": 0.24332945048809052,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.3909124698011522,
      "grad_norm": 0.5772337913513184,
      "learning_rate": 2.085730995076341e-06,
      "loss": 0.1287,
      "mae_dtheta": 0.02834460325539112,
      "mae_dx": 0.008607478812336922,
      "mae_dy": 0.004109699744731188,
      "pose_mae_dtheta": 0.21686847507953644,
      "pose_mae_dx": 0.06500852108001709,
      "pose_mae_dy": 0.05821802839636803,
      "pose_rmse_dtheta": 0.39827197790145874,
      "pose_rmse_dx": 0.14966221153736115,
      "pose_rmse_dy": 0.14634250104427338,
      "pose_rmse_mean": 0.23142556846141815,
      "rmse_dtheta": 0.04636756703257561,
      "rmse_dx": 0.02009309083223343,
      "rmse_dy": 0.008192092180252075,
      "rmse_mean": 0.02488425001502037,
      "rotation_flip": 0.010544815100729465,
      "sparse_tokens": 20310.0,
      "step": 8414,
      "turn_loss": 0.21122920513153076,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.39095892956699496,
      "grad_norm": 0.42131102085113525,
      "learning_rate": 2.0846566920793265e-06,
      "loss": 0.0853,
      "mae_dtheta": 0.0101908128708601,
      "mae_dx": 0.002424404490739107,
      "mae_dy": 0.0033655650913715363,
      "pose_mae_dtheta": 0.06964433938264847,
      "pose_mae_dx": 0.02990272268652916,
      "pose_mae_dy": 0.02845776453614235,
      "pose_rmse_dtheta": 0.1745702624320984,
      "pose_rmse_dx": 0.08669950067996979,
      "pose_rmse_dy": 0.07212629914283752,
      "pose_rmse_mean": 0.11113201826810837,
      "rmse_dtheta": 0.024635640904307365,
      "rmse_dx": 0.006063269916921854,
      "rmse_dy": 0.008628832176327705,
      "rmse_mean": 0.013109247200191021,
      "rotation_flip": 0.005214600823819637,
      "sparse_tokens": 32153.0,
      "step": 8415,
      "turn_loss": 0.09529067575931549,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.39100538933283774,
      "grad_norm": 0.9365736246109009,
      "learning_rate": 2.083582592953837e-06,
      "loss": 0.2366,
      "mae_dtheta": 0.026609234511852264,
      "mae_dx": 0.006326408591121435,
      "mae_dy": 0.0049894023686647415,
      "pose_mae_dtheta": 0.17030157148838043,
      "pose_mae_dx": 0.05240698531270027,
      "pose_mae_dy": 0.05772358924150467,
      "pose_rmse_dtheta": 0.3512044847011566,
      "pose_rmse_dx": 0.1147090345621109,
      "pose_rmse_dy": 0.11538117378950119,
      "pose_rmse_mean": 0.19376491010189056,
      "rmse_dtheta": 0.04261453077197075,
      "rmse_dx": 0.016274312511086464,
      "rmse_dy": 0.008427182212471962,
      "rmse_mean": 0.02243867516517639,
      "rotation_flip": 0.01807228848338127,
      "sparse_tokens": 5327.0,
      "step": 8416,
      "turn_loss": 0.1735484004020691,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 36014.0,
      "epoch": 0.3910518490986805,
      "grad_norm": 0.5598205327987671,
      "learning_rate": 2.0825086977749793e-06,
      "loss": 0.1109,
      "mae_dtheta": 0.03656269982457161,
      "mae_dx": 0.011951982043683529,
      "mae_dy": 0.003902329597622156,
      "pose_mae_dtheta": 0.28778475522994995,
      "pose_mae_dx": 0.09329166263341904,
      "pose_mae_dy": 0.04770958796143532,
      "pose_rmse_dtheta": 0.4964064061641693,
      "pose_rmse_dx": 0.20940472185611725,
      "pose_rmse_dy": 0.11701495200395584,
      "pose_rmse_mean": 0.27427536249160767,
      "rmse_dtheta": 0.05564012750983238,
      "rmse_dx": 0.024560105055570602,
      "rmse_dy": 0.007625413592904806,
      "rmse_mean": 0.029275216162204742,
      "rotation_flip": 0.010459035634994507,
      "sparse_tokens": 29037.0,
      "step": 8417,
      "turn_loss": 0.24789811670780182,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.39109830886452335,
      "grad_norm": 0.4583311975002289,
      "learning_rate": 2.081435006617856e-06,
      "loss": 0.126,
      "mae_dtheta": 0.00724388612434268,
      "mae_dx": 0.001608409802429378,
      "mae_dy": 0.0013421407202258706,
      "pose_mae_dtheta": 0.048491086810827255,
      "pose_mae_dx": 0.01733941026031971,
      "pose_mae_dy": 0.01776108145713806,
      "pose_rmse_dtheta": 0.14411960542201996,
      "pose_rmse_dx": 0.048720669001340866,
      "pose_rmse_dy": 0.0476495660841465,
      "pose_rmse_mean": 0.08016328513622284,
      "rmse_dtheta": 0.01989470236003399,
      "rmse_dx": 0.005443135742098093,
      "rmse_dy": 0.0033555589616298676,
      "rmse_mean": 0.009564465843141079,
      "rotation_flip": 0.004926108289510012,
      "sparse_tokens": 32073.0,
      "step": 8418,
      "turn_loss": 0.056416433304548264,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3911447686303661,
      "grad_norm": 0.5964130759239197,
      "learning_rate": 2.080361519557548e-06,
      "loss": 0.1306,
      "mae_dtheta": 0.008892876096069813,
      "mae_dx": 0.0014042349066585302,
      "mae_dy": 0.00150785269215703,
      "pose_mae_dtheta": 0.06314362585544586,
      "pose_mae_dx": 0.018578119575977325,
      "pose_mae_dy": 0.01958485133945942,
      "pose_rmse_dtheta": 0.211351215839386,
      "pose_rmse_dx": 0.060653652995824814,
      "pose_rmse_dy": 0.0453825443983078,
      "pose_rmse_mean": 0.10579580068588257,
      "rmse_dtheta": 0.023391474038362503,
      "rmse_dx": 0.005505001172423363,
      "rmse_dy": 0.0034385486505925655,
      "rmse_mean": 0.010778341442346573,
      "rotation_flip": 0.004102563951164484,
      "sparse_tokens": 32041.0,
      "step": 8419,
      "turn_loss": 0.0604601688683033,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.3911912283962089,
      "grad_norm": 0.5503900051116943,
      "learning_rate": 2.0792882366691258e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.006691864226013422,
      "mae_dx": 0.003285573096945882,
      "mae_dy": 0.0016300412826240063,
      "pose_mae_dtheta": 0.047826774418354034,
      "pose_mae_dx": 0.033750180155038834,
      "pose_mae_dy": 0.022110143676400185,
      "pose_rmse_dtheta": 0.12704885005950928,
      "pose_rmse_dx": 0.12336776405572891,
      "pose_rmse_dy": 0.054417941719293594,
      "pose_rmse_mean": 0.10161151736974716,
      "rmse_dtheta": 0.017863715067505836,
      "rmse_dx": 0.011840831488370895,
      "rmse_dy": 0.003935889340937138,
      "rmse_mean": 0.011213479563593864,
      "rotation_flip": 0.0069532236084342,
      "sparse_tokens": 32025.0,
      "step": 8420,
      "turn_loss": 0.09870556741952896,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.3912376881620517,
      "grad_norm": 0.3674198091030121,
      "learning_rate": 2.0782151580276467e-06,
      "loss": 0.0932,
      "mae_dtheta": 0.04015025496482849,
      "mae_dx": 0.01381237804889679,
      "mae_dy": 0.008111385628581047,
      "pose_mae_dtheta": 0.3247872292995453,
      "pose_mae_dx": 0.11473588645458221,
      "pose_mae_dy": 0.07575524598360062,
      "pose_rmse_dtheta": 0.5283478498458862,
      "pose_rmse_dx": 0.2424025535583496,
      "pose_rmse_dy": 0.20149734616279602,
      "pose_rmse_mean": 0.3240825831890106,
      "rmse_dtheta": 0.058316417038440704,
      "rmse_dx": 0.026252014562487602,
      "rmse_dy": 0.01706877164542675,
      "rmse_mean": 0.03387907147407532,
      "rotation_flip": 0.014170040376484394,
      "sparse_tokens": 16472.0,
      "step": 8421,
      "turn_loss": 0.29047420620918274,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.39128414792789445,
      "grad_norm": 0.5350332856178284,
      "learning_rate": 2.0771422837081477e-06,
      "loss": 0.1063,
      "mae_dtheta": 0.02961023524403572,
      "mae_dx": 0.014265182428061962,
      "mae_dy": 0.003827816341072321,
      "pose_mae_dtheta": 0.20378516614437103,
      "pose_mae_dx": 0.11955666542053223,
      "pose_mae_dy": 0.05786045268177986,
      "pose_rmse_dtheta": 0.38855284452438354,
      "pose_rmse_dx": 0.29900333285331726,
      "pose_rmse_dy": 0.12431072443723679,
      "pose_rmse_mean": 0.2706223130226135,
      "rmse_dtheta": 0.04563969001173973,
      "rmse_dx": 0.03061019442975521,
      "rmse_dy": 0.006922658067196608,
      "rmse_mean": 0.02772418037056923,
      "rotation_flip": 0.006593406666070223,
      "sparse_tokens": 8487.0,
      "step": 8422,
      "turn_loss": 0.19198015332221985,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.39133060769373723,
      "grad_norm": 0.6771406531333923,
      "learning_rate": 2.07606961378566e-06,
      "loss": 0.0771,
      "mae_dtheta": 0.00724036805331707,
      "mae_dx": 0.0013477561296895146,
      "mae_dy": 0.000891338218934834,
      "pose_mae_dtheta": 0.05869152769446373,
      "pose_mae_dx": 0.012100663036108017,
      "pose_mae_dy": 0.010906719602644444,
      "pose_rmse_dtheta": 0.2437930703163147,
      "pose_rmse_dx": 0.03168599680066109,
      "pose_rmse_dy": 0.031297337263822556,
      "pose_rmse_mean": 0.10225880146026611,
      "rmse_dtheta": 0.024125484749674797,
      "rmse_dx": 0.004044483881443739,
      "rmse_dy": 0.002531067468225956,
      "rmse_mean": 0.010233679786324501,
      "rotation_flip": 0.0015007504262030125,
      "sparse_tokens": 32169.0,
      "step": 8423,
      "turn_loss": 0.04243851080536842,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.39137706745958,
      "grad_norm": 0.5589948296546936,
      "learning_rate": 2.074997148335191e-06,
      "loss": 0.1473,
      "mae_dtheta": 0.03681296482682228,
      "mae_dx": 0.013881020247936249,
      "mae_dy": 0.007868573069572449,
      "pose_mae_dtheta": 0.27714109420776367,
      "pose_mae_dx": 0.11486299335956573,
      "pose_mae_dy": 0.06887006759643555,
      "pose_rmse_dtheta": 0.5177151560783386,
      "pose_rmse_dx": 0.23797982931137085,
      "pose_rmse_dy": 0.1807556450366974,
      "pose_rmse_mean": 0.3121502101421356,
      "rmse_dtheta": 0.05742399021983147,
      "rmse_dx": 0.02593836560845375,
      "rmse_dy": 0.017168870195746422,
      "rmse_mean": 0.03351040929555893,
      "rotation_flip": 0.009671179577708244,
      "sparse_tokens": 17443.0,
      "step": 8424,
      "turn_loss": 0.28843924403190613,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.3914235272254228,
      "grad_norm": 0.5351653099060059,
      "learning_rate": 2.073924887431744e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.03011379763484001,
      "mae_dx": 0.013433923944830894,
      "mae_dy": 0.004336446989327669,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5351652503013611,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.15306091308594,
      "model/head/act_norm_mean": 109.65526208212209,
      "model/head/act_norm_min": 70.43667602539062,
      "model/head/act_over_embed": 75.3561227115724,
      "model/head/grad_frac": 0.1086958646774292,
      "model/head/grad_norm": 0.05817025154829025,
      "model/head/grad_zero_frac": 0.00016053952276706696,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6989462209302325,
      "model/head/update_ratio": 0.0009908560896292329,
      "model/head/weight_delta": 9.768033981323242,
      "model/head/weight_delta_rel": 0.17136025428771973,
      "model/head/weight_norm": 58.707061767578125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42223820090293884,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42223820090293884,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42223820090293884,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29016604471681784,
      "model/modality_embedder.encoders.pose/grad_frac": 0.058984048664569855,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03156621381640434,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010193317430093884,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1168313026428223,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10183659195899963,
      "model/modality_embedder.encoders.pose/weight_norm": 30.967557907104492,
      "model/modality_embedder/grad_frac": 0.058984048664569855,
      "model/modality_embedder/grad_norm": 0.03156621381640434,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.55078125,
      "model/modality_embedder/update_ratio": 0.0010193317430093884,
      "model/modality_embedder/weight_delta": 3.1168313026428223,
      "model/modality_embedder/weight_delta_rel": 0.10183659195899963,
      "model/modality_embedder/weight_norm": 30.967557907104492,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.46461486816406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.552769702842376,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.219712257385254,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.185683844297344,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0813937783241272,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04355912283062935,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015592070994898677,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6332156658172607,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09595596790313721,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.93671417236328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.90475463867188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.357604282022887,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.743769645690918,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.73877370209024,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08393518626689911,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.044919196516275406,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001510830014012754,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.338701009750366,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11565521359443665,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.731470108032227,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.81106567382812,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.921465485418974,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.563702583312988,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.813473762163287,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0983402207493782,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05262826755642891,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017142737051472068,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6111390590667725,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1212552860379219,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.700037002563477,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.82878112792969,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.75998408084164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.350136756896973,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.07692095342002,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11035414785146713,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.059057705104351044,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019736706744879484,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.096417188644409,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10582084208726883,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.922775268554688,
      "model/normalizer/grad_frac": 0.41790276765823364,
      "model/normalizer/grad_norm": 0.22364704310894012,
      "model/normalizer/grad_zero_frac": 0.00020562247664202005,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002844884293153882,
      "model/normalizer/weight_delta": 6.5288310050964355,
      "model/normalizer/weight_delta_rel": 0.0840875655412674,
      "model/normalizer/weight_norm": 78.61375427246094,
      "pose_mae_dtheta": 0.22406886518001556,
      "pose_mae_dx": 0.09510321170091629,
      "pose_mae_dy": 0.04227849096059799,
      "pose_rmse_dtheta": 0.43376579880714417,
      "pose_rmse_dx": 0.22560817003250122,
      "pose_rmse_dy": 0.0886940211057663,
      "pose_rmse_mean": 0.24935601651668549,
      "rmse_dtheta": 0.04777687042951584,
      "rmse_dx": 0.026600588113069534,
      "rmse_dy": 0.008705493994057178,
      "rmse_mean": 0.027694320306181908,
      "rotation_flip": 0.010169491171836853,
      "sparse_tokens": 11402.0,
      "step": 8425,
      "turn_loss": 0.26493901014328003,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.39146998699126556,
      "grad_norm": 0.6760954856872559,
      "learning_rate": 2.0728528311502977e-06,
      "loss": 0.1631,
      "mae_dtheta": 0.010540436953306198,
      "mae_dx": 0.0019028889946639538,
      "mae_dy": 0.002809199271723628,
      "pose_mae_dtheta": 0.07043971866369247,
      "pose_mae_dx": 0.0263785719871521,
      "pose_mae_dy": 0.031568970531225204,
      "pose_rmse_dtheta": 0.15255072712898254,
      "pose_rmse_dx": 0.06882117688655853,
      "pose_rmse_dy": 0.07764840126037598,
      "pose_rmse_mean": 0.09967343509197235,
      "rmse_dtheta": 0.02195614017546177,
      "rmse_dx": 0.00579196447506547,
      "rmse_dy": 0.006761312019079924,
      "rmse_mean": 0.01150313951075077,
      "rotation_flip": 0.0020946795120835304,
      "sparse_tokens": 32073.0,
      "step": 8426,
      "turn_loss": 0.08450029045343399,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.39151644675710834,
      "grad_norm": 0.42023369669914246,
      "learning_rate": 2.0717809795658243e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.03087574429810047,
      "mae_dx": 0.009426438249647617,
      "mae_dy": 0.0038127414882183075,
      "pose_mae_dtheta": 0.2449972927570343,
      "pose_mae_dx": 0.06980520486831665,
      "pose_mae_dy": 0.035356555134058,
      "pose_rmse_dtheta": 0.4034421741962433,
      "pose_rmse_dx": 0.1677131950855255,
      "pose_rmse_dy": 0.09409575909376144,
      "pose_rmse_mean": 0.2217503786087036,
      "rmse_dtheta": 0.04718616604804993,
      "rmse_dx": 0.020700527355074883,
      "rmse_dy": 0.010277584195137024,
      "rmse_mean": 0.026054760441184044,
      "rotation_flip": 0.019021738320589066,
      "sparse_tokens": 10754.0,
      "step": 8427,
      "turn_loss": 0.29076531529426575,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 5853.0,
      "epoch": 0.3915629065229511,
      "grad_norm": 0.3779125511646271,
      "learning_rate": 2.0707093327532807e-06,
      "loss": 0.1222,
      "mae_dtheta": 0.034357599914073944,
      "mae_dx": 0.012754150666296482,
      "mae_dy": 0.0052833473309874535,
      "pose_mae_dtheta": 0.27736300230026245,
      "pose_mae_dx": 0.09950853884220123,
      "pose_mae_dy": 0.07893030345439911,
      "pose_rmse_dtheta": 0.5087864995002747,
      "pose_rmse_dx": 0.23452460765838623,
      "pose_rmse_dy": 0.18087558448314667,
      "pose_rmse_mean": 0.30806225538253784,
      "rmse_dtheta": 0.05411229282617569,
      "rmse_dx": 0.026905078440904617,
      "rmse_dy": 0.009170481003820896,
      "rmse_mean": 0.030062619596719742,
      "rotation_flip": 0.007194244768470526,
      "sparse_tokens": 4824.0,
      "step": 8428,
      "turn_loss": 0.23525412380695343,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.3916093662887939,
      "grad_norm": 0.6896535754203796,
      "learning_rate": 2.0696378907876035e-06,
      "loss": 0.1406,
      "mae_dtheta": 0.03458213433623314,
      "mae_dx": 0.008289298973977566,
      "mae_dy": 0.004800254013389349,
      "pose_mae_dtheta": 0.29112035036087036,
      "pose_mae_dx": 0.05871405452489853,
      "pose_mae_dy": 0.055662062019109726,
      "pose_rmse_dtheta": 0.5292317867279053,
      "pose_rmse_dx": 0.1489139199256897,
      "pose_rmse_dy": 0.12175427377223969,
      "pose_rmse_mean": 0.2666333317756653,
      "rmse_dtheta": 0.055566154420375824,
      "rmse_dx": 0.01979348435997963,
      "rmse_dy": 0.011867598630487919,
      "rmse_mean": 0.02907574735581875,
      "rotation_flip": 0.021479712799191475,
      "sparse_tokens": 7477.0,
      "step": 8429,
      "turn_loss": 0.2503316104412079,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.39165582605463667,
      "grad_norm": 0.696649968624115,
      "learning_rate": 2.0685666537437233e-06,
      "loss": 0.1732,
      "mae_dtheta": 0.037994273006916046,
      "mae_dx": 0.021672382950782776,
      "mae_dy": 0.0077426852658391,
      "pose_mae_dtheta": 0.3348693549633026,
      "pose_mae_dx": 0.1752350628376007,
      "pose_mae_dy": 0.09259206056594849,
      "pose_rmse_dtheta": 0.52198326587677,
      "pose_rmse_dx": 0.36064013838768005,
      "pose_rmse_dy": 0.1881798654794693,
      "pose_rmse_mean": 0.35693442821502686,
      "rmse_dtheta": 0.053495753556489944,
      "rmse_dx": 0.03755973279476166,
      "rmse_dy": 0.012534544803202152,
      "rmse_mean": 0.03453001007437706,
      "rotation_flip": 0.014652014710009098,
      "sparse_tokens": 8430.0,
      "step": 8430,
      "turn_loss": 0.38089850544929504,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.39170228582047945,
      "grad_norm": 0.4389181435108185,
      "learning_rate": 2.0674956216965484e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.041610412299633026,
      "mae_dx": 0.009216553531587124,
      "mae_dy": 0.004761963617056608,
      "pose_mae_dtheta": 0.317380428314209,
      "pose_mae_dx": 0.0747651532292366,
      "pose_mae_dy": 0.062048643827438354,
      "pose_rmse_dtheta": 0.5933142900466919,
      "pose_rmse_dx": 0.1654205024242401,
      "pose_rmse_dy": 0.17332018911838531,
      "pose_rmse_mean": 0.31068500876426697,
      "rmse_dtheta": 0.06236634403467178,
      "rmse_dx": 0.02058115229010582,
      "rmse_dy": 0.009448050521314144,
      "rmse_mean": 0.030798515304923058,
      "rotation_flip": 0.013254786841571331,
      "sparse_tokens": 11076.0,
      "step": 8431,
      "turn_loss": 0.2812751829624176,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.3917487455863222,
      "grad_norm": 0.5547889471054077,
      "learning_rate": 2.0664247947209794e-06,
      "loss": 0.127,
      "mae_dtheta": 0.02574150264263153,
      "mae_dx": 0.011153163388371468,
      "mae_dy": 0.0039332653395831585,
      "pose_mae_dtheta": 0.1817273050546646,
      "pose_mae_dx": 0.0874762088060379,
      "pose_mae_dy": 0.03592966869473457,
      "pose_rmse_dtheta": 0.3148234486579895,
      "pose_rmse_dx": 0.18980799615383148,
      "pose_rmse_dy": 0.09446875751018524,
      "pose_rmse_mean": 0.19970008730888367,
      "rmse_dtheta": 0.03927763178944588,
      "rmse_dx": 0.023357314988970757,
      "rmse_dy": 0.008013484068214893,
      "rmse_mean": 0.023549478501081467,
      "rotation_flip": 0.01566951535642147,
      "sparse_tokens": 11437.0,
      "step": 8432,
      "turn_loss": 0.20971345901489258,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.391795205352165,
      "grad_norm": 0.9664096832275391,
      "learning_rate": 2.0653541728919002e-06,
      "loss": 0.1487,
      "mae_dtheta": 0.025135094299912453,
      "mae_dx": 0.005886443424969912,
      "mae_dy": 0.0032224643509835005,
      "pose_mae_dtheta": 0.17295873165130615,
      "pose_mae_dx": 0.041584406048059464,
      "pose_mae_dy": 0.03952210023999214,
      "pose_rmse_dtheta": 0.31730446219444275,
      "pose_rmse_dx": 0.09802587330341339,
      "pose_rmse_dy": 0.09534336626529694,
      "pose_rmse_mean": 0.17022457718849182,
      "rmse_dtheta": 0.04223764315247536,
      "rmse_dx": 0.014215570874512196,
      "rmse_dy": 0.006871317513287067,
      "rmse_mean": 0.021108178421854973,
      "rotation_flip": 0.011976048350334167,
      "sparse_tokens": 10206.0,
      "step": 8433,
      "turn_loss": 0.16597771644592285,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.39184166511800783,
      "grad_norm": 0.5478129386901855,
      "learning_rate": 2.0642837562841772e-06,
      "loss": 0.1204,
      "mae_dtheta": 0.022908659651875496,
      "mae_dx": 0.007787620183080435,
      "mae_dy": 0.008297854103147984,
      "pose_mae_dtheta": 0.13775663077831268,
      "pose_mae_dx": 0.05616655573248863,
      "pose_mae_dy": 0.11132486909627914,
      "pose_rmse_dtheta": 0.23461399972438812,
      "pose_rmse_dx": 0.1509568989276886,
      "pose_rmse_dy": 0.19948799908161163,
      "pose_rmse_mean": 0.19501963257789612,
      "rmse_dtheta": 0.03366309031844139,
      "rmse_dx": 0.020685462281107903,
      "rmse_dy": 0.012249884195625782,
      "rmse_mean": 0.0221994798630476,
      "rotation_flip": 0.010548523627221584,
      "sparse_tokens": 8420.0,
      "step": 8434,
      "turn_loss": 0.2751493453979492,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3918881248838506,
      "grad_norm": 0.48107215762138367,
      "learning_rate": 2.0632135449726687e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.008045043796300888,
      "mae_dx": 0.0014522381825372577,
      "mae_dy": 0.0025476375594735146,
      "pose_mae_dtheta": 0.05022215098142624,
      "pose_mae_dx": 0.020758530125021935,
      "pose_mae_dy": 0.025626149028539658,
      "pose_rmse_dtheta": 0.10664917528629303,
      "pose_rmse_dx": 0.053269531577825546,
      "pose_rmse_dy": 0.059779971837997437,
      "pose_rmse_mean": 0.07323289662599564,
      "rmse_dtheta": 0.016093119978904724,
      "rmse_dx": 0.003725016489624977,
      "rmse_dy": 0.005736376624554396,
      "rmse_mean": 0.00851817149668932,
      "rotation_flip": 0.00561797758564353,
      "sparse_tokens": 32121.0,
      "step": 8435,
      "turn_loss": 0.06983275711536407,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29524.0,
      "epoch": 0.3919345846496934,
      "grad_norm": 0.42811092734336853,
      "learning_rate": 2.0621435390322116e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.03072577714920044,
      "mae_dx": 0.011467240750789642,
      "mae_dy": 0.00404254300519824,
      "pose_mae_dtheta": 0.2502284049987793,
      "pose_mae_dx": 0.09034604579210281,
      "pose_mae_dy": 0.046173956245183945,
      "pose_rmse_dtheta": 0.47176334261894226,
      "pose_rmse_dx": 0.21261823177337646,
      "pose_rmse_dy": 0.12515297532081604,
      "pose_rmse_mean": 0.2698448598384857,
      "rmse_dtheta": 0.051262643188238144,
      "rmse_dx": 0.024135686457157135,
      "rmse_dy": 0.010003827512264252,
      "rmse_mean": 0.028467385098338127,
      "rotation_flip": 0.009098428301513195,
      "sparse_tokens": 22917.0,
      "step": 8436,
      "turn_loss": 0.22444652020931244,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.39198104441553616,
      "grad_norm": 0.27872434258461,
      "learning_rate": 2.061073738537635e-06,
      "loss": 0.0738,
      "mae_dtheta": 0.006811765022575855,
      "mae_dx": 0.0011669185478240252,
      "mae_dy": 0.0006842978182248771,
      "pose_mae_dtheta": 0.04686437547206879,
      "pose_mae_dx": 0.010295585729181767,
      "pose_mae_dy": 0.009510045871138573,
      "pose_rmse_dtheta": 0.17278309166431427,
      "pose_rmse_dx": 0.022798649966716766,
      "pose_rmse_dy": 0.030332474038004875,
      "pose_rmse_mean": 0.07530473917722702,
      "rmse_dtheta": 0.023432185873389244,
      "rmse_dx": 0.003059188835322857,
      "rmse_dy": 0.0017115866066887975,
      "rmse_mean": 0.009400987066328526,
      "rotation_flip": 0.001861330820247531,
      "sparse_tokens": 32201.0,
      "step": 8437,
      "turn_loss": 0.04510748013854027,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.39202750418137894,
      "grad_norm": 0.5236268043518066,
      "learning_rate": 2.0600041435637475e-06,
      "loss": 0.0879,
      "mae_dtheta": 0.035417087376117706,
      "mae_dx": 0.010759463533759117,
      "mae_dy": 0.008217904716730118,
      "pose_mae_dtheta": 0.2857647240161896,
      "pose_mae_dx": 0.09713604301214218,
      "pose_mae_dy": 0.09071552008390427,
      "pose_rmse_dtheta": 0.485105037689209,
      "pose_rmse_dx": 0.21029390394687653,
      "pose_rmse_dy": 0.20540860295295715,
      "pose_rmse_mean": 0.3002691864967346,
      "rmse_dtheta": 0.05161094665527344,
      "rmse_dx": 0.022076552733778954,
      "rmse_dy": 0.015470340847969055,
      "rmse_mean": 0.029719281941652298,
      "rotation_flip": 0.014814814552664757,
      "sparse_tokens": 15488.0,
      "step": 8438,
      "turn_loss": 0.22136904299259186,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3920739639472217,
      "grad_norm": 0.3838021755218506,
      "learning_rate": 2.0589347541853507e-06,
      "loss": 0.0811,
      "mae_dtheta": 0.010398524813354015,
      "mae_dx": 0.00212568836286664,
      "mae_dy": 0.002597786020487547,
      "pose_mae_dtheta": 0.07198775559663773,
      "pose_mae_dx": 0.021403614431619644,
      "pose_mae_dy": 0.03273949772119522,
      "pose_rmse_dtheta": 0.1670508086681366,
      "pose_rmse_dx": 0.05673551931977272,
      "pose_rmse_dy": 0.08342274278402328,
      "pose_rmse_mean": 0.10240302979946136,
      "rmse_dtheta": 0.021915750578045845,
      "rmse_dx": 0.007175451144576073,
      "rmse_dy": 0.0067577664740383625,
      "rmse_mean": 0.011949656531214714,
      "rotation_flip": 0.006958657409995794,
      "sparse_tokens": 32073.0,
      "step": 8439,
      "turn_loss": 0.09091107547283173,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3921204237130645,
      "grad_norm": 0.4673705995082855,
      "learning_rate": 2.0578655704772227e-06,
      "loss": 0.143,
      "mae_dtheta": 0.007200677879154682,
      "mae_dx": 0.0012769465101882815,
      "mae_dy": 0.0013831757241860032,
      "pose_mae_dtheta": 0.048963747918605804,
      "pose_mae_dx": 0.013974490575492382,
      "pose_mae_dy": 0.01852591149508953,
      "pose_rmse_dtheta": 0.11387234181165695,
      "pose_rmse_dx": 0.04228384420275688,
      "pose_rmse_dy": 0.04167228192090988,
      "pose_rmse_mean": 0.06594282388687134,
      "rmse_dtheta": 0.015650900080800056,
      "rmse_dx": 0.0046540796756744385,
      "rmse_dy": 0.00287865218706429,
      "rmse_mean": 0.007727877702564001,
      "rotation_flip": 0.004244482144713402,
      "sparse_tokens": 32105.0,
      "step": 8440,
      "turn_loss": 0.05978301167488098,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.39216688347890727,
      "grad_norm": 0.5790284276008606,
      "learning_rate": 2.0567965925141366e-06,
      "loss": 0.1607,
      "mae_dtheta": 0.02957789972424507,
      "mae_dx": 0.009662066586315632,
      "mae_dy": 0.006230384111404419,
      "pose_mae_dtheta": 0.2526159882545471,
      "pose_mae_dx": 0.08441564440727234,
      "pose_mae_dy": 0.09755803644657135,
      "pose_rmse_dtheta": 0.4292129874229431,
      "pose_rmse_dx": 0.19656983017921448,
      "pose_rmse_dy": 0.23852191865444183,
      "pose_rmse_mean": 0.2881016135215759,
      "rmse_dtheta": 0.04608725383877754,
      "rmse_dx": 0.02051411010324955,
      "rmse_dy": 0.011275168508291245,
      "rmse_mean": 0.025958847254514694,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 15225.0,
      "step": 8441,
      "turn_loss": 0.2737283408641815,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.39221334324475005,
      "grad_norm": 0.5289985537528992,
      "learning_rate": 2.0557278203708426e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.04634905606508255,
      "mae_dx": 0.01799600198864937,
      "mae_dy": 0.006498879287391901,
      "pose_mae_dtheta": 0.354515016078949,
      "pose_mae_dx": 0.14073720574378967,
      "pose_mae_dy": 0.10384155809879303,
      "pose_rmse_dtheta": 0.6000818610191345,
      "pose_rmse_dx": 0.28214389085769653,
      "pose_rmse_dy": 0.21777087450027466,
      "pose_rmse_mean": 0.3666655421257019,
      "rmse_dtheta": 0.06399042904376984,
      "rmse_dx": 0.03221471607685089,
      "rmse_dy": 0.010835695080459118,
      "rmse_mean": 0.03568027913570404,
      "rotation_flip": 0.00958466436713934,
      "sparse_tokens": 5854.0,
      "step": 8442,
      "turn_loss": 0.33938416838645935,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 27903.0,
      "epoch": 0.3922598030105928,
      "grad_norm": 1.004927158355713,
      "learning_rate": 2.054659254122084e-06,
      "loss": 0.2622,
      "mae_dtheta": 0.04037908837199211,
      "mae_dx": 0.010602160356938839,
      "mae_dy": 0.0057146139442920685,
      "pose_mae_dtheta": 0.3118802011013031,
      "pose_mae_dx": 0.08062149584293365,
      "pose_mae_dy": 0.07022649794816971,
      "pose_rmse_dtheta": 0.5326210856437683,
      "pose_rmse_dx": 0.19800403714179993,
      "pose_rmse_dy": 0.14907626807689667,
      "pose_rmse_mean": 0.29323381185531616,
      "rmse_dtheta": 0.05899262800812721,
      "rmse_dx": 0.023052599281072617,
      "rmse_dy": 0.012417580001056194,
      "rmse_mean": 0.0314876027405262,
      "rotation_flip": 0.011196641251444817,
      "sparse_tokens": 22633.0,
      "step": 8443,
      "turn_loss": 0.32873573899269104,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.3923062627764356,
      "grad_norm": 0.47940361499786377,
      "learning_rate": 2.053590893842583e-06,
      "loss": 0.113,
      "mae_dtheta": 0.04142657667398453,
      "mae_dx": 0.011925415135920048,
      "mae_dy": 0.00422355392947793,
      "pose_mae_dtheta": 0.3089369833469391,
      "pose_mae_dx": 0.07855262607336044,
      "pose_mae_dy": 0.03932956978678703,
      "pose_rmse_dtheta": 0.5624943375587463,
      "pose_rmse_dx": 0.18493829667568207,
      "pose_rmse_dy": 0.09857436269521713,
      "pose_rmse_mean": 0.282002329826355,
      "rmse_dtheta": 0.06316316872835159,
      "rmse_dx": 0.02464551292359829,
      "rmse_dy": 0.009928801096975803,
      "rmse_mean": 0.03257916122674942,
      "rotation_flip": 0.013303769752383232,
      "sparse_tokens": 7068.0,
      "step": 8444,
      "turn_loss": 0.31005197763442993,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3923527225422784,
      "grad_norm": 0.7390011548995972,
      "learning_rate": 2.052522739607054e-06,
      "loss": 0.1238,
      "mae_dtheta": 0.012137340381741524,
      "mae_dx": 0.0032562348060309887,
      "mae_dy": 0.002856370061635971,
      "pose_mae_dtheta": 0.08859799802303314,
      "pose_mae_dx": 0.03447820991277695,
      "pose_mae_dy": 0.03489474207162857,
      "pose_rmse_dtheta": 0.23370243608951569,
      "pose_rmse_dx": 0.1094391718506813,
      "pose_rmse_dy": 0.09886056929826736,
      "pose_rmse_mean": 0.14733406901359558,
      "rmse_dtheta": 0.02754794806241989,
      "rmse_dx": 0.01060499157756567,
      "rmse_dy": 0.0075866179540753365,
      "rmse_mean": 0.015246519818902016,
      "rotation_flip": 0.009333333000540733,
      "sparse_tokens": 32089.0,
      "step": 8445,
      "turn_loss": 0.12205719947814941,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.39239918230812115,
      "grad_norm": 0.3999680280685425,
      "learning_rate": 2.05145479149019e-06,
      "loss": 0.1018,
      "mae_dtheta": 0.012548589147627354,
      "mae_dx": 0.0013241651467978954,
      "mae_dy": 0.0023807373363524675,
      "pose_mae_dtheta": 0.0799577385187149,
      "pose_mae_dx": 0.016922062262892723,
      "pose_mae_dy": 0.03200150281190872,
      "pose_rmse_dtheta": 0.2104542851448059,
      "pose_rmse_dx": 0.04219740629196167,
      "pose_rmse_dy": 0.08368026465177536,
      "pose_rmse_mean": 0.11211065948009491,
      "rmse_dtheta": 0.027836883440613747,
      "rmse_dx": 0.004447628278285265,
      "rmse_dy": 0.0059145293198525906,
      "rmse_mean": 0.012733014300465584,
      "rotation_flip": 0.01171875,
      "sparse_tokens": 32089.0,
      "step": 8446,
      "turn_loss": 0.09579866379499435,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.39244564207396393,
      "grad_norm": 0.4689134359359741,
      "learning_rate": 2.0503870495666767e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.008830726146697998,
      "mae_dx": 0.0011709628161042929,
      "mae_dy": 0.00020653341198340058,
      "pose_mae_dtheta": 0.0640278309583664,
      "pose_mae_dx": 0.009656938724219799,
      "pose_mae_dy": 0.0031991740688681602,
      "pose_rmse_dtheta": 0.2835150957107544,
      "pose_rmse_dx": 0.024508018046617508,
      "pose_rmse_dy": 0.006614077370613813,
      "pose_rmse_mean": 0.10487907379865646,
      "rmse_dtheta": 0.03285333886742592,
      "rmse_dx": 0.0032668174244463444,
      "rmse_dy": 0.000497539876960218,
      "rmse_mean": 0.012205898761749268,
      "rotation_flip": 0.000627352565061301,
      "sparse_tokens": 32201.0,
      "step": 8447,
      "turn_loss": 0.033760711550712585,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.3924921018398067,
      "grad_norm": 0.39147159457206726,
      "learning_rate": 2.0493195139111787e-06,
      "loss": 0.0583,
      "mae_dtheta": 0.020266711711883545,
      "mae_dx": 0.003008270636200905,
      "mae_dy": 0.0029508904553949833,
      "pose_mae_dtheta": 0.12565359473228455,
      "pose_mae_dx": 0.019559431821107864,
      "pose_mae_dy": 0.041580360382795334,
      "pose_rmse_dtheta": 0.21864446997642517,
      "pose_rmse_dx": 0.048015933483839035,
      "pose_rmse_dy": 0.10652187466621399,
      "pose_rmse_mean": 0.12439408898353577,
      "rmse_dtheta": 0.03720464929938316,
      "rmse_dx": 0.007465573959052563,
      "rmse_dy": 0.006216440349817276,
      "rmse_mean": 0.016962222754955292,
      "rotation_flip": 0.02074688859283924,
      "sparse_tokens": 3910.0,
      "step": 8448,
      "turn_loss": 0.17310616374015808,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.3925385616056495,
      "grad_norm": 0.5077277421951294,
      "learning_rate": 2.0482521845983522e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.03688061237335205,
      "mae_dx": 0.010259955190122128,
      "mae_dy": 0.003385719144716859,
      "pose_mae_dtheta": 0.29553085565567017,
      "pose_mae_dx": 0.08857793360948563,
      "pose_mae_dy": 0.036685697734355927,
      "pose_rmse_dtheta": 0.5214235782623291,
      "pose_rmse_dx": 0.19860383868217468,
      "pose_rmse_dy": 0.08655628561973572,
      "pose_rmse_mean": 0.2688612639904022,
      "rmse_dtheta": 0.05602144077420235,
      "rmse_dx": 0.021702950820326805,
      "rmse_dy": 0.007412293925881386,
      "rmse_mean": 0.028378894552588463,
      "rotation_flip": 0.01364764291793108,
      "sparse_tokens": 13346.0,
      "step": 8449,
      "turn_loss": 0.23640060424804688,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.3925850213714923,
      "grad_norm": 0.630821943283081,
      "learning_rate": 2.047185061702833e-06,
      "loss": 0.1421,
      "mae_dtheta": 0.030150992795825005,
      "mae_dx": 0.014212248846888542,
      "mae_dy": 0.006069826427847147,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6308218836784363,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 149.29348754882812,
      "model/head/act_norm_mean": 104.77854870211694,
      "model/head/act_norm_min": 77.04491424560547,
      "model/head/act_over_embed": 72.00479962032286,
      "model/head/grad_frac": 0.10916191339492798,
      "model/head/grad_norm": 0.06886172294616699,
      "model/head/grad_zero_frac": 0.00017830674187280238,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7058026713709677,
      "model/head/update_ratio": 0.001172955147922039,
      "model/head/weight_delta": 9.771600723266602,
      "model/head/weight_delta_rel": 0.1714228242635727,
      "model/head/weight_norm": 58.707889556884766,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223079979419708,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42223814129829407,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4221871495246887,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2901660037559479,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09798882901668549,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06181349977850914,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.53314208984375,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019960724748671055,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1161065101623535,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10181291401386261,
      "model/modality_embedder.encoders.pose/weight_norm": 30.967561721801758,
      "model/modality_embedder/grad_frac": 0.09798882901668549,
      "model/modality_embedder/grad_norm": 0.06181349977850914,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.53314208984375,
      "model/modality_embedder/update_ratio": 0.0019960724748671055,
      "model/modality_embedder/weight_delta": 3.1161065101623535,
      "model/modality_embedder/weight_delta_rel": 0.10181291401386261,
      "model/modality_embedder/weight_norm": 30.967561721801758,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 78.13546752929688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.1050287218382,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.100557327270508,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.877992050334166,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1061374768614769,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06695384532213211,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0023965926375240088,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.635111093521118,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09602503478527069,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.93709945678711,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.8455581665039,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.90354982718894,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.773836135864258,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.426743229803566,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09425221383571625,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05945635959506035,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019997097551822662,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.341860294342041,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11576465517282486,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.73249626159668,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.60274505615234,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.538170442908346,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.38492488861084,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.55006982048526,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09650672227144241,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06087855249643326,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001982942223548889,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.614227294921875,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12135898321866989,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.701122283935547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 80.33989715576172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.48428499423963,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.663956642150879,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.887457959971606,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08504356443881989,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05364734306931496,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001792800147086382,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.0994369983673096,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10592404752969742,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.92377281188965,
      "model/normalizer/grad_frac": 0.34132978320121765,
      "model/normalizer/grad_norm": 0.21531829237937927,
      "model/normalizer/grad_zero_frac": 0.0002115311799570918,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0027389011811465025,
      "model/normalizer/weight_delta": 6.5346150398254395,
      "model/normalizer/weight_delta_rel": 0.08416205644607544,
      "model/normalizer/weight_norm": 78.6148452758789,
      "pose_mae_dtheta": 0.22930969297885895,
      "pose_mae_dx": 0.11355823278427124,
      "pose_mae_dy": 0.09589120745658875,
      "pose_rmse_dtheta": 0.4065115749835968,
      "pose_rmse_dx": 0.2829783856868744,
      "pose_rmse_dy": 0.21645355224609375,
      "pose_rmse_mean": 0.3019811809062958,
      "rmse_dtheta": 0.04801563918590546,
      "rmse_dx": 0.029442617669701576,
      "rmse_dy": 0.011303347535431385,
      "rmse_mean": 0.02958720177412033,
      "rotation_flip": 0.010615711100399494,
      "sparse_tokens": 8474.0,
      "step": 8450,
      "turn_loss": 0.31076234579086304,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 62507.0,
      "epoch": 0.3926314811373351,
      "grad_norm": 0.40177953243255615,
      "learning_rate": 2.0461181452992494e-06,
      "loss": 0.0925,
      "mae_dtheta": 0.009599884040653706,
      "mae_dx": 0.0015982387121766806,
      "mae_dy": 0.0025545447133481503,
      "pose_mae_dtheta": 0.060915663838386536,
      "pose_mae_dx": 0.020893283188343048,
      "pose_mae_dy": 0.027918584644794464,
      "pose_rmse_dtheta": 0.12650974094867706,
      "pose_rmse_dx": 0.0486573651432991,
      "pose_rmse_dy": 0.057444073259830475,
      "pose_rmse_mean": 0.07753705978393555,
      "rmse_dtheta": 0.018720757216215134,
      "rmse_dx": 0.004700026474893093,
      "rmse_dy": 0.00514372019097209,
      "rmse_mean": 0.009521502070128918,
      "rotation_flip": 0.006508422549813986,
      "sparse_tokens": 31907.0,
      "step": 8451,
      "turn_loss": 0.08797454833984375,
      "turns": 192.0,
      "turns_per_sample": 192.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.39267794090317787,
      "grad_norm": 0.4426177442073822,
      "learning_rate": 2.0450514354622075e-06,
      "loss": 0.1312,
      "mae_dtheta": 0.029645036906003952,
      "mae_dx": 0.012026429176330566,
      "mae_dy": 0.005822643171995878,
      "pose_mae_dtheta": 0.2041759043931961,
      "pose_mae_dx": 0.09811069816350937,
      "pose_mae_dy": 0.07049141079187393,
      "pose_rmse_dtheta": 0.35429561138153076,
      "pose_rmse_dx": 0.22495396435260773,
      "pose_rmse_dy": 0.1536063849925995,
      "pose_rmse_mean": 0.24428531527519226,
      "rmse_dtheta": 0.04461941868066788,
      "rmse_dx": 0.02498854696750641,
      "rmse_dy": 0.009935878217220306,
      "rmse_mean": 0.02651461586356163,
      "rotation_flip": 0.009668508544564247,
      "sparse_tokens": 12811.0,
      "step": 8452,
      "turn_loss": 0.29786521196365356,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.39272440066902065,
      "grad_norm": 0.912442684173584,
      "learning_rate": 2.0439849322663053e-06,
      "loss": 0.1959,
      "mae_dtheta": 0.0355435349047184,
      "mae_dx": 0.011448605917394161,
      "mae_dy": 0.004473759792745113,
      "pose_mae_dtheta": 0.2818590998649597,
      "pose_mae_dx": 0.08382656425237656,
      "pose_mae_dy": 0.05850616469979286,
      "pose_rmse_dtheta": 0.4765337407588959,
      "pose_rmse_dx": 0.18182292580604553,
      "pose_rmse_dy": 0.15577469766139984,
      "pose_rmse_mean": 0.2713771462440491,
      "rmse_dtheta": 0.053355928510427475,
      "rmse_dx": 0.023435605689883232,
      "rmse_dy": 0.009310564957559109,
      "rmse_mean": 0.028700700029730797,
      "rotation_flip": 0.010779435746371746,
      "sparse_tokens": 20086.0,
      "step": 8453,
      "turn_loss": 0.23900054395198822,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3927708604348634,
      "grad_norm": 0.5000576376914978,
      "learning_rate": 2.042918635786124e-06,
      "loss": 0.1015,
      "mae_dtheta": 0.009053737856447697,
      "mae_dx": 0.0015263374662026763,
      "mae_dy": 0.0024305761326104403,
      "pose_mae_dtheta": 0.05658532679080963,
      "pose_mae_dx": 0.020923107862472534,
      "pose_mae_dy": 0.03056764416396618,
      "pose_rmse_dtheta": 0.11059323698282242,
      "pose_rmse_dx": 0.050949033349752426,
      "pose_rmse_dy": 0.06769391149282455,
      "pose_rmse_mean": 0.07641206681728363,
      "rmse_dtheta": 0.017832882702350616,
      "rmse_dx": 0.00468062236905098,
      "rmse_dy": 0.005348446313291788,
      "rmse_mean": 0.009287317283451557,
      "rotation_flip": 0.008220303803682327,
      "sparse_tokens": 32073.0,
      "step": 8454,
      "turn_loss": 0.08021814376115799,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3928173202007062,
      "grad_norm": 0.7435624599456787,
      "learning_rate": 2.0418525460962283e-06,
      "loss": 0.1769,
      "mae_dtheta": 0.008743480779230595,
      "mae_dx": 0.0015631354181095958,
      "mae_dy": 0.0018039386486634612,
      "pose_mae_dtheta": 0.058880411088466644,
      "pose_mae_dx": 0.018994692713022232,
      "pose_mae_dy": 0.021581493318080902,
      "pose_rmse_dtheta": 0.1507142186164856,
      "pose_rmse_dx": 0.054836660623550415,
      "pose_rmse_dy": 0.05461660027503967,
      "pose_rmse_mean": 0.0867224931716919,
      "rmse_dtheta": 0.02154730260372162,
      "rmse_dx": 0.005298982374370098,
      "rmse_dy": 0.0041623832657933235,
      "rmse_mean": 0.010336223058402538,
      "rotation_flip": 0.0031545741949230433,
      "sparse_tokens": 32073.0,
      "step": 8455,
      "turn_loss": 0.06889710575342178,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.392863779966549,
      "grad_norm": 0.3099267780780792,
      "learning_rate": 2.0407866632711742e-06,
      "loss": 0.0647,
      "mae_dtheta": 0.005936948116868734,
      "mae_dx": 0.0012678188504651189,
      "mae_dy": 0.0014243548503145576,
      "pose_mae_dtheta": 0.037668365985155106,
      "pose_mae_dx": 0.01492374762892723,
      "pose_mae_dy": 0.014270232059061527,
      "pose_rmse_dtheta": 0.10410431772470474,
      "pose_rmse_dx": 0.03327728435397148,
      "pose_rmse_dy": 0.03100757487118244,
      "pose_rmse_mean": 0.05612972378730774,
      "rmse_dtheta": 0.016628915444016457,
      "rmse_dx": 0.0032212119549512863,
      "rmse_dy": 0.0031083927024155855,
      "rmse_mean": 0.007652840577065945,
      "rotation_flip": 0.0020815986208617687,
      "sparse_tokens": 32121.0,
      "step": 8456,
      "turn_loss": 0.048212505877017975,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.39291023973239175,
      "grad_norm": 0.4024502635002136,
      "learning_rate": 2.0397209873854946e-06,
      "loss": 0.1024,
      "mae_dtheta": 0.032829806208610535,
      "mae_dx": 0.015490659512579441,
      "mae_dy": 0.005593560170382261,
      "pose_mae_dtheta": 0.17910237610340118,
      "pose_mae_dx": 0.12278365343809128,
      "pose_mae_dy": 0.07490720599889755,
      "pose_rmse_dtheta": 0.2648661136627197,
      "pose_rmse_dx": 0.25049450993537903,
      "pose_rmse_dy": 0.15237700939178467,
      "pose_rmse_mean": 0.2225792109966278,
      "rmse_dtheta": 0.045107994228601456,
      "rmse_dx": 0.0291089229285717,
      "rmse_dy": 0.009024301543831825,
      "rmse_mean": 0.027747072279453278,
      "rotation_flip": 0.01287553645670414,
      "sparse_tokens": 4145.0,
      "step": 8457,
      "turn_loss": 0.2999989688396454,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.39295669949823453,
      "grad_norm": 0.32999446988105774,
      "learning_rate": 2.0386555185137156e-06,
      "loss": 0.0554,
      "mae_dtheta": 0.0072140758857131,
      "mae_dx": 0.0014222910394892097,
      "mae_dy": 0.0003148635441903025,
      "pose_mae_dtheta": 0.05306026339530945,
      "pose_mae_dx": 0.010106894187629223,
      "pose_mae_dy": 0.004501423332840204,
      "pose_rmse_dtheta": 0.23099221289157867,
      "pose_rmse_dx": 0.030843501910567284,
      "pose_rmse_dy": 0.014181447215378284,
      "pose_rmse_mean": 0.09200572222471237,
      "rmse_dtheta": 0.02695349045097828,
      "rmse_dx": 0.004522464703768492,
      "rmse_dy": 0.0008399173384532332,
      "rmse_mean": 0.010771958157420158,
      "rotation_flip": 0.000598444021306932,
      "sparse_tokens": 32217.0,
      "step": 8458,
      "turn_loss": 0.04346315935254097,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14944.0,
      "epoch": 0.3930031592640773,
      "grad_norm": 0.5262325406074524,
      "learning_rate": 2.0375902567303474e-06,
      "loss": 0.1178,
      "mae_dtheta": 0.03522590175271034,
      "mae_dx": 0.009262358769774437,
      "mae_dy": 0.004429757595062256,
      "pose_mae_dtheta": 0.27999037504196167,
      "pose_mae_dx": 0.07029183954000473,
      "pose_mae_dy": 0.05464751273393631,
      "pose_rmse_dtheta": 0.5408759713172913,
      "pose_rmse_dx": 0.17692407965660095,
      "pose_rmse_dy": 0.14926330745220184,
      "pose_rmse_mean": 0.2890211343765259,
      "rmse_dtheta": 0.058551616966724396,
      "rmse_dx": 0.021023917943239212,
      "rmse_dy": 0.009392544627189636,
      "rmse_mean": 0.029656028375029564,
      "rotation_flip": 0.022608695551753044,
      "sparse_tokens": 11412.0,
      "step": 8459,
      "turn_loss": 0.2788337767124176,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.3930496190299201,
      "grad_norm": 1.2497254610061646,
      "learning_rate": 2.03652520210988e-06,
      "loss": 0.2432,
      "mae_dtheta": 0.03273792192339897,
      "mae_dx": 0.01029030792415142,
      "mae_dy": 0.004165358375757933,
      "pose_mae_dtheta": 0.27447184920310974,
      "pose_mae_dx": 0.08028676360845566,
      "pose_mae_dy": 0.054451461881399155,
      "pose_rmse_dtheta": 0.4680272340774536,
      "pose_rmse_dx": 0.17853787541389465,
      "pose_rmse_dy": 0.12537738680839539,
      "pose_rmse_mean": 0.25731417536735535,
      "rmse_dtheta": 0.050577208399772644,
      "rmse_dx": 0.02251802757382393,
      "rmse_dy": 0.00826504360884428,
      "rmse_mean": 0.027120091021060944,
      "rotation_flip": 0.013368983753025532,
      "sparse_tokens": 13603.0,
      "step": 8460,
      "turn_loss": 0.22345174849033356,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.39309607879576286,
      "grad_norm": 0.5107126832008362,
      "learning_rate": 2.0354603547267985e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.04159129783511162,
      "mae_dx": 0.013330342248082161,
      "mae_dy": 0.0085117407143116,
      "pose_mae_dtheta": 0.3492925465106964,
      "pose_mae_dx": 0.09343867003917694,
      "pose_mae_dy": 0.06394098699092865,
      "pose_rmse_dtheta": 0.5618181824684143,
      "pose_rmse_dx": 0.2177102118730545,
      "pose_rmse_dy": 0.14917637407779694,
      "pose_rmse_mean": 0.30956825613975525,
      "rmse_dtheta": 0.05860472843050957,
      "rmse_dx": 0.025770436972379684,
      "rmse_dy": 0.01921265944838524,
      "rmse_mean": 0.03452927619218826,
      "rotation_flip": 0.009345794096589088,
      "sparse_tokens": 8854.0,
      "step": 8461,
      "turn_loss": 0.3854334354400635,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.39314253856160564,
      "grad_norm": 0.5671421885490417,
      "learning_rate": 2.0343957146555636e-06,
      "loss": 0.1616,
      "mae_dtheta": 0.03131270781159401,
      "mae_dx": 0.005392702762037516,
      "mae_dy": 0.004545575473457575,
      "pose_mae_dtheta": 0.22504472732543945,
      "pose_mae_dx": 0.04905470460653305,
      "pose_mae_dy": 0.06359705328941345,
      "pose_rmse_dtheta": 0.44402700662612915,
      "pose_rmse_dx": 0.11993256211280823,
      "pose_rmse_dy": 0.15207964181900024,
      "pose_rmse_mean": 0.23867975175380707,
      "rmse_dtheta": 0.05051087960600853,
      "rmse_dx": 0.014416199177503586,
      "rmse_dy": 0.009855976328253746,
      "rmse_mean": 0.024927686899900436,
      "rotation_flip": 0.010362694039940834,
      "sparse_tokens": 11328.0,
      "step": 8462,
      "turn_loss": 0.21408458054065704,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3931889983274484,
      "grad_norm": 0.49071356654167175,
      "learning_rate": 2.03333128197063e-06,
      "loss": 0.1091,
      "mae_dtheta": 0.008377596735954285,
      "mae_dx": 0.0013837303267791867,
      "mae_dy": 0.0015431406209245324,
      "pose_mae_dtheta": 0.058517154306173325,
      "pose_mae_dx": 0.01715065725147724,
      "pose_mae_dy": 0.02342996373772621,
      "pose_rmse_dtheta": 0.12491901218891144,
      "pose_rmse_dx": 0.04815664514899254,
      "pose_rmse_dy": 0.05491543188691139,
      "pose_rmse_mean": 0.07599703222513199,
      "rmse_dtheta": 0.01782945916056633,
      "rmse_dx": 0.004752058535814285,
      "rmse_dy": 0.003166029928252101,
      "rmse_mean": 0.008582515642046928,
      "rotation_flip": 0.0036555645056068897,
      "sparse_tokens": 32089.0,
      "step": 8463,
      "turn_loss": 0.057941291481256485,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3932354580932912,
      "grad_norm": 0.48231667280197144,
      "learning_rate": 2.0322670567464304e-06,
      "loss": 0.1071,
      "mae_dtheta": 0.010296456515789032,
      "mae_dx": 0.003175802296027541,
      "mae_dy": 0.004041853826493025,
      "pose_mae_dtheta": 0.07453659176826477,
      "pose_mae_dx": 0.03756071999669075,
      "pose_mae_dy": 0.03230564668774605,
      "pose_rmse_dtheta": 0.1934046745300293,
      "pose_rmse_dx": 0.09857692569494247,
      "pose_rmse_dy": 0.08413396775722504,
      "pose_rmse_mean": 0.12537185847759247,
      "rmse_dtheta": 0.0243266299366951,
      "rmse_dx": 0.008409649133682251,
      "rmse_dy": 0.009989774785935879,
      "rmse_mean": 0.014242018572986126,
      "rotation_flip": 0.006016847211867571,
      "sparse_tokens": 32121.0,
      "step": 8464,
      "turn_loss": 0.10787000507116318,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.39328191785913397,
      "grad_norm": 0.42601609230041504,
      "learning_rate": 2.031203039057388e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.03678002581000328,
      "mae_dx": 0.013767566531896591,
      "mae_dy": 0.00786230992525816,
      "pose_mae_dtheta": 0.2605133652687073,
      "pose_mae_dx": 0.10173049569129944,
      "pose_mae_dy": 0.09181451797485352,
      "pose_rmse_dtheta": 0.48537299036979675,
      "pose_rmse_dx": 0.221116840839386,
      "pose_rmse_dy": 0.20946204662322998,
      "pose_rmse_mean": 0.3053172826766968,
      "rmse_dtheta": 0.05624863877892494,
      "rmse_dx": 0.027820976451039314,
      "rmse_dy": 0.01569320634007454,
      "rmse_mean": 0.03325427696108818,
      "rotation_flip": 0.014184396713972092,
      "sparse_tokens": 8896.0,
      "step": 8465,
      "turn_loss": 0.3417466878890991,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.39332837762497674,
      "grad_norm": 0.6152181625366211,
      "learning_rate": 2.0301392289779125e-06,
      "loss": 0.1699,
      "mae_dtheta": 0.028605323284864426,
      "mae_dx": 0.009389186277985573,
      "mae_dy": 0.004549155477434397,
      "pose_mae_dtheta": 0.1959620863199234,
      "pose_mae_dx": 0.06329987198114395,
      "pose_mae_dy": 0.06395074725151062,
      "pose_rmse_dtheta": 0.3673400580883026,
      "pose_rmse_dx": 0.16537807881832123,
      "pose_rmse_dy": 0.14990445971488953,
      "pose_rmse_mean": 0.22754085063934326,
      "rmse_dtheta": 0.047771912068128586,
      "rmse_dx": 0.020824719220399857,
      "rmse_dy": 0.00928722694516182,
      "rmse_mean": 0.025961285457015038,
      "rotation_flip": 0.009950248524546623,
      "sparse_tokens": 11084.0,
      "step": 8466,
      "turn_loss": 0.2532293200492859,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.3933748373908196,
      "grad_norm": 0.8664937615394592,
      "learning_rate": 2.029075626582393e-06,
      "loss": 0.3249,
      "mae_dtheta": 0.035283997654914856,
      "mae_dx": 0.007678875233978033,
      "mae_dy": 0.008082898333668709,
      "pose_mae_dtheta": 0.2408793866634369,
      "pose_mae_dx": 0.05796104297041893,
      "pose_mae_dy": 0.08876526355743408,
      "pose_rmse_dtheta": 0.40602144598960876,
      "pose_rmse_dx": 0.10813981294631958,
      "pose_rmse_dy": 0.19233843684196472,
      "pose_rmse_mean": 0.23549990355968475,
      "rmse_dtheta": 0.05286313593387604,
      "rmse_dx": 0.01674998365342617,
      "rmse_dy": 0.015294171869754791,
      "rmse_mean": 0.028302431106567383,
      "rotation_flip": 0.019163763150572777,
      "sparse_tokens": 9302.0,
      "step": 8467,
      "turn_loss": 0.24669134616851807,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.39342129715666235,
      "grad_norm": 0.4302592873573303,
      "learning_rate": 2.028012231945211e-06,
      "loss": 0.0756,
      "mae_dtheta": 0.010990039445459843,
      "mae_dx": 0.0017766660312190652,
      "mae_dy": 0.0022416417486965656,
      "pose_mae_dtheta": 0.07784213125705719,
      "pose_mae_dx": 0.021866515278816223,
      "pose_mae_dy": 0.021833375096321106,
      "pose_rmse_dtheta": 0.23540759086608887,
      "pose_rmse_dx": 0.0696679875254631,
      "pose_rmse_dy": 0.06731218844652176,
      "pose_rmse_mean": 0.12412925809621811,
      "rmse_dtheta": 0.028076164424419403,
      "rmse_dx": 0.00618771044537425,
      "rmse_dy": 0.0070965043269097805,
      "rmse_mean": 0.013786792755126953,
      "rotation_flip": 0.008418254554271698,
      "sparse_tokens": 32121.0,
      "step": 8468,
      "turn_loss": 0.0746554508805275,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12961.0,
      "epoch": 0.39346775692250513,
      "grad_norm": 0.685430645942688,
      "learning_rate": 2.0269490451407277e-06,
      "loss": 0.1553,
      "mae_dtheta": 0.028242791071534157,
      "mae_dx": 0.01184057630598545,
      "mae_dy": 0.005545330233871937,
      "pose_mae_dtheta": 0.20841765403747559,
      "pose_mae_dx": 0.10251720994710922,
      "pose_mae_dy": 0.06769397854804993,
      "pose_rmse_dtheta": 0.38044509291648865,
      "pose_rmse_dx": 0.20936007797718048,
      "pose_rmse_dy": 0.16923655569553375,
      "pose_rmse_mean": 0.2530139088630676,
      "rmse_dtheta": 0.04524436965584755,
      "rmse_dx": 0.023313168436288834,
      "rmse_dy": 0.010982662439346313,
      "rmse_mean": 0.02651340141892433,
      "rotation_flip": 0.009630818851292133,
      "sparse_tokens": 10774.0,
      "step": 8469,
      "turn_loss": 0.289502888917923,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3935142166883479,
      "grad_norm": 0.4630810022354126,
      "learning_rate": 2.0258860662432946e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.007370891515165567,
      "mae_dx": 0.0014858519425615668,
      "mae_dy": 0.0018187969690188766,
      "pose_mae_dtheta": 0.049123115837574005,
      "pose_mae_dx": 0.0157015360891819,
      "pose_mae_dy": 0.017647940665483475,
      "pose_rmse_dtheta": 0.13098929822444916,
      "pose_rmse_dx": 0.05222339928150177,
      "pose_rmse_dy": 0.04407057911157608,
      "pose_rmse_mean": 0.0757610946893692,
      "rmse_dtheta": 0.01890219748020172,
      "rmse_dx": 0.005678435321897268,
      "rmse_dy": 0.005606906022876501,
      "rmse_mean": 0.010062513872981071,
      "rotation_flip": 0.0035242291633039713,
      "sparse_tokens": 32105.0,
      "step": 8470,
      "turn_loss": 0.0654725506901741,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.3935606764541907,
      "grad_norm": 0.4600474238395691,
      "learning_rate": 2.0248232953272435e-06,
      "loss": 0.1214,
      "mae_dtheta": 0.031069647520780563,
      "mae_dx": 0.013390054926276207,
      "mae_dy": 0.006106398534029722,
      "pose_mae_dtheta": 0.23601990938186646,
      "pose_mae_dx": 0.12998440861701965,
      "pose_mae_dy": 0.0724768415093422,
      "pose_rmse_dtheta": 0.40885964035987854,
      "pose_rmse_dx": 0.27910667657852173,
      "pose_rmse_dy": 0.14334917068481445,
      "pose_rmse_mean": 0.2771051824092865,
      "rmse_dtheta": 0.04859728366136551,
      "rmse_dx": 0.02688801847398281,
      "rmse_dy": 0.010533811524510384,
      "rmse_mean": 0.028673037886619568,
      "rotation_flip": 0.015317286364734173,
      "sparse_tokens": 18079.0,
      "step": 8471,
      "turn_loss": 0.28360432386398315,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.39360713622003346,
      "grad_norm": 0.5344817042350769,
      "learning_rate": 2.0237607324668963e-06,
      "loss": 0.1934,
      "mae_dtheta": 0.03546041622757912,
      "mae_dx": 0.012027522549033165,
      "mae_dy": 0.006743203848600388,
      "pose_mae_dtheta": 0.2703491151332855,
      "pose_mae_dx": 0.09760092198848724,
      "pose_mae_dy": 0.07586725801229477,
      "pose_rmse_dtheta": 0.48517465591430664,
      "pose_rmse_dx": 0.21553915739059448,
      "pose_rmse_dy": 0.18076306581497192,
      "pose_rmse_mean": 0.293825626373291,
      "rmse_dtheta": 0.05367936193943024,
      "rmse_dx": 0.023512521758675575,
      "rmse_dy": 0.015280341729521751,
      "rmse_mean": 0.030824076384305954,
      "rotation_flip": 0.01720183528959751,
      "sparse_tokens": 16789.0,
      "step": 8472,
      "turn_loss": 0.2998298704624176,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.39365359598587624,
      "grad_norm": 0.6931530833244324,
      "learning_rate": 2.0226983777365604e-06,
      "loss": 0.135,
      "mae_dtheta": 0.013369360007345676,
      "mae_dx": 0.002335234312340617,
      "mae_dy": 0.003919969778507948,
      "pose_mae_dtheta": 0.08997827023267746,
      "pose_mae_dx": 0.038319699466228485,
      "pose_mae_dy": 0.044213034212589264,
      "pose_rmse_dtheta": 0.19125784933567047,
      "pose_rmse_dx": 0.0859549343585968,
      "pose_rmse_dy": 0.10395035147666931,
      "pose_rmse_mean": 0.1270543932914734,
      "rmse_dtheta": 0.02508961781859398,
      "rmse_dx": 0.0059809391386806965,
      "rmse_dy": 0.007699991576373577,
      "rmse_mean": 0.01292351633310318,
      "rotation_flip": 0.005638474132865667,
      "sparse_tokens": 32105.0,
      "step": 8473,
      "turn_loss": 0.11207545548677444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.393700055751719,
      "grad_norm": 0.5173155069351196,
      "learning_rate": 2.021636231210523e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.05163085088133812,
      "mae_dx": 0.02184435911476612,
      "mae_dy": 0.02017199993133545,
      "pose_mae_dtheta": 0.42526862025260925,
      "pose_mae_dx": 0.15166699886322021,
      "pose_mae_dy": 0.19616787135601044,
      "pose_rmse_dtheta": 0.6213335990905762,
      "pose_rmse_dx": 0.32595378160476685,
      "pose_rmse_dy": 0.3797352910041809,
      "pose_rmse_mean": 0.4423409104347229,
      "rmse_dtheta": 0.06757428497076035,
      "rmse_dx": 0.03608002886176109,
      "rmse_dy": 0.028459949418902397,
      "rmse_mean": 0.044038087129592896,
      "rotation_flip": 0.007518797181546688,
      "sparse_tokens": 2566.0,
      "step": 8474,
      "turn_loss": 0.6687320470809937,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3937465155175618,
      "grad_norm": 0.34048524498939514,
      "learning_rate": 2.0205742929630647e-06,
      "loss": 0.0627,
      "mae_dtheta": 0.006953111849725246,
      "mae_dx": 0.0011863819090649486,
      "mae_dy": 0.001985764130949974,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.340485155582428,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.29330444335938,
      "model/head/act_norm_mean": 112.09583136047979,
      "model/head/act_norm_min": 67.7109146118164,
      "model/head/act_over_embed": 77.03330476862939,
      "model/head/grad_frac": 0.11867499351501465,
      "model/head/grad_norm": 0.04040707275271416,
      "model/head/grad_zero_frac": 0.00019131487351842225,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7014135495580808,
      "model/head/update_ratio": 0.0006882620509713888,
      "model/head/weight_delta": 9.775750160217285,
      "model/head/weight_delta_rel": 0.17149561643600464,
      "model/head/weight_norm": 58.7088508605957,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223501980304718,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42228450018928965,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42220333218574524,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29019786201985887,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0939093828201294,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03197475150227547,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5422460077092511,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001032523112371564,
      "model/modality_embedder.encoders.pose/weight_delta": 3.11873722076416,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10189886391162872,
      "model/modality_embedder.encoders.pose/weight_norm": 30.967588424682617,
      "model/modality_embedder/grad_frac": 0.0939093828201294,
      "model/modality_embedder/grad_norm": 0.03197475150227547,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5422460077092511,
      "model/modality_embedder/update_ratio": 0.001032523112371564,
      "model/modality_embedder/weight_delta": 3.11873722076416,
      "model/modality_embedder/weight_delta_rel": 0.10189886391162872,
      "model/modality_embedder/weight_norm": 30.967588424682617,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.20792388916016,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.89917528459195,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.017190933227539,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.423737003175805,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08843296021223068,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.030110111460089684,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010777567513287067,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.637089729309082,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09609714150428772,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.937763214111328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.09806823730469,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.911230359147027,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.48369312286377,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.11923072541894,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09677420556545258,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.032950181514024734,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001108188065700233,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3445913791656494,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1158592626452446,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.73338508605957,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.9727783203125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.765604958313293,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.90714168548584,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.39357431089452,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0983760803937912,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.033495593816041946,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010909908451139927,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6172070503234863,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12145903706550598,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.701993942260742,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.81596374511719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.485367063492063,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.132963180541992,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.575410930239872,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10933323949575424,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.037226345390081406,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012440079590305686,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.102335214614868,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10602309554815292,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.924524307250977,
      "model/normalizer/grad_frac": 0.3783603012561798,
      "model/normalizer/grad_norm": 0.1288260668516159,
      "model/normalizer/grad_zero_frac": 0.0001689885975793004,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016386773204430938,
      "model/normalizer/weight_delta": 6.540073871612549,
      "model/normalizer/weight_delta_rel": 0.08423236757516861,
      "model/normalizer/weight_norm": 78.61588287353516,
      "pose_mae_dtheta": 0.0439440943300724,
      "pose_mae_dx": 0.01546145137399435,
      "pose_mae_dy": 0.019087592139840126,
      "pose_rmse_dtheta": 0.08562419563531876,
      "pose_rmse_dx": 0.05113498121500015,
      "pose_rmse_dy": 0.04501362517476082,
      "pose_rmse_mean": 0.06059093400835991,
      "rmse_dtheta": 0.014640018343925476,
      "rmse_dx": 0.0033568667713552713,
      "rmse_dy": 0.004947141278535128,
      "rmse_mean": 0.00764800887554884,
      "rotation_flip": 0.003023177618160844,
      "sparse_tokens": 32137.0,
      "step": 8475,
      "turn_loss": 0.062098704278469086,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.39379297528340457,
      "grad_norm": 0.4385329782962799,
      "learning_rate": 2.019512563068443e-06,
      "loss": 0.1117,
      "mae_dtheta": 0.006094817072153091,
      "mae_dx": 0.0020727405790239573,
      "mae_dy": 0.0009111412218771875,
      "pose_mae_dtheta": 0.04204186052083969,
      "pose_mae_dx": 0.020405789837241173,
      "pose_mae_dy": 0.012899739667773247,
      "pose_rmse_dtheta": 0.16471798717975616,
      "pose_rmse_dx": 0.07409568130970001,
      "pose_rmse_dy": 0.04366416484117508,
      "pose_rmse_mean": 0.09415927529335022,
      "rmse_dtheta": 0.02153986319899559,
      "rmse_dx": 0.008460396900773048,
      "rmse_dy": 0.0036600858438760042,
      "rmse_mean": 0.011220115236938,
      "rotation_flip": 0.002103786915540695,
      "sparse_tokens": 32105.0,
      "step": 8476,
      "turn_loss": 0.06838443875312805,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.39383943504924734,
      "grad_norm": 0.41023504734039307,
      "learning_rate": 2.0184510416009097e-06,
      "loss": 0.0723,
      "mae_dtheta": 0.007163486443459988,
      "mae_dx": 0.0010028397664427757,
      "mae_dy": 0.0011613770620897412,
      "pose_mae_dtheta": 0.048363376408815384,
      "pose_mae_dx": 0.013541020452976227,
      "pose_mae_dy": 0.016804523766040802,
      "pose_rmse_dtheta": 0.14708001911640167,
      "pose_rmse_dx": 0.038057468831539154,
      "pose_rmse_dy": 0.045018553733825684,
      "pose_rmse_mean": 0.07671868056058884,
      "rmse_dtheta": 0.01966897025704384,
      "rmse_dx": 0.0036860108375549316,
      "rmse_dy": 0.0027774586342275143,
      "rmse_mean": 0.008710813708603382,
      "rotation_flip": 0.002847380470484495,
      "sparse_tokens": 32057.0,
      "step": 8477,
      "turn_loss": 0.047630924731492996,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.3938858948150901,
      "grad_norm": 0.6551275849342346,
      "learning_rate": 2.017389728634693e-06,
      "loss": 0.1648,
      "mae_dtheta": 0.032265570014715195,
      "mae_dx": 0.01194658875465393,
      "mae_dy": 0.009050899185240269,
      "pose_mae_dtheta": 0.2917288839817047,
      "pose_mae_dx": 0.10589592158794403,
      "pose_mae_dy": 0.09625830501317978,
      "pose_rmse_dtheta": 0.4195622205734253,
      "pose_rmse_dx": 0.22053968906402588,
      "pose_rmse_dy": 0.18605753779411316,
      "pose_rmse_mean": 0.2753865122795105,
      "rmse_dtheta": 0.04274020716547966,
      "rmse_dx": 0.022594599053263664,
      "rmse_dy": 0.016408538445830345,
      "rmse_mean": 0.027247782796621323,
      "rotation_flip": 0.014888337813317776,
      "sparse_tokens": 7365.0,
      "step": 8478,
      "turn_loss": 0.3503550887107849,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.3939323545809329,
      "grad_norm": 0.6049085259437561,
      "learning_rate": 2.0163286242440155e-06,
      "loss": 0.1901,
      "mae_dtheta": 0.029169147834181786,
      "mae_dx": 0.011070405133068562,
      "mae_dy": 0.002487342804670334,
      "pose_mae_dtheta": 0.21632081270217896,
      "pose_mae_dx": 0.08370816707611084,
      "pose_mae_dy": 0.026899918913841248,
      "pose_rmse_dtheta": 0.3992290794849396,
      "pose_rmse_dx": 0.2016788274049759,
      "pose_rmse_dy": 0.06775961816310883,
      "pose_rmse_mean": 0.22288918495178223,
      "rmse_dtheta": 0.04753574728965759,
      "rmse_dx": 0.02341248281300068,
      "rmse_dy": 0.004981562960892916,
      "rmse_mean": 0.025309931486845016,
      "rotation_flip": 0.015587530098855495,
      "sparse_tokens": 14883.0,
      "step": 8479,
      "turn_loss": 0.21251921355724335,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3939788143467757,
      "grad_norm": 0.5874758958816528,
      "learning_rate": 2.015267728503077e-06,
      "loss": 0.1351,
      "mae_dtheta": 0.010179019533097744,
      "mae_dx": 0.002619372680783272,
      "mae_dy": 0.002873210934922099,
      "pose_mae_dtheta": 0.07354936003684998,
      "pose_mae_dx": 0.02610798552632332,
      "pose_mae_dy": 0.028150316327810287,
      "pose_rmse_dtheta": 0.17529550194740295,
      "pose_rmse_dx": 0.07490713149309158,
      "pose_rmse_dy": 0.06457434594631195,
      "pose_rmse_mean": 0.10492565482854843,
      "rmse_dtheta": 0.023300141096115112,
      "rmse_dx": 0.008325458504259586,
      "rmse_dy": 0.007495249155908823,
      "rmse_mean": 0.01304028369486332,
      "rotation_flip": 0.007293666247278452,
      "sparse_tokens": 32137.0,
      "step": 8480,
      "turn_loss": 0.12122229486703873,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.39402527411261845,
      "grad_norm": 0.4226377308368683,
      "learning_rate": 2.0142070414860704e-06,
      "loss": 0.123,
      "mae_dtheta": 0.019850924611091614,
      "mae_dx": 0.006032791454344988,
      "mae_dy": 0.004209978971630335,
      "pose_mae_dtheta": 0.12733569741249084,
      "pose_mae_dx": 0.04799012467265129,
      "pose_mae_dy": 0.04508122429251671,
      "pose_rmse_dtheta": 0.30550646781921387,
      "pose_rmse_dx": 0.1526181548833847,
      "pose_rmse_dy": 0.09746545553207397,
      "pose_rmse_mean": 0.18519669771194458,
      "rmse_dtheta": 0.036020807921886444,
      "rmse_dx": 0.017986243590712547,
      "rmse_dy": 0.0076396772637963295,
      "rmse_mean": 0.020548909902572632,
      "rotation_flip": 0.021176470443606377,
      "sparse_tokens": 7973.0,
      "step": 8481,
      "turn_loss": 0.18333587050437927,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.39407173387846123,
      "grad_norm": 0.5090314745903015,
      "learning_rate": 2.0131465632671655e-06,
      "loss": 0.0768,
      "mae_dtheta": 0.03668452054262161,
      "mae_dx": 0.023616285994648933,
      "mae_dy": 0.004586447961628437,
      "pose_mae_dtheta": 0.24011094868183136,
      "pose_mae_dx": 0.23955222964286804,
      "pose_mae_dy": 0.07897777110338211,
      "pose_rmse_dtheta": 0.3703702688217163,
      "pose_rmse_dx": 0.38899388909339905,
      "pose_rmse_dy": 0.16864511370658875,
      "pose_rmse_mean": 0.30933642387390137,
      "rmse_dtheta": 0.05002966895699501,
      "rmse_dx": 0.037623081356287,
      "rmse_dy": 0.007928679697215557,
      "rmse_mean": 0.03186047822237015,
      "rotation_flip": 0.024193547666072845,
      "sparse_tokens": 2764.0,
      "step": 8482,
      "turn_loss": 0.3649453818798065,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 6843.0,
      "epoch": 0.39411819364430406,
      "grad_norm": 0.56023108959198,
      "learning_rate": 2.012086293920527e-06,
      "loss": 0.1351,
      "mae_dtheta": 0.02934260107576847,
      "mae_dx": 0.009858643636107445,
      "mae_dy": 0.0027791510801762342,
      "pose_mae_dtheta": 0.24679064750671387,
      "pose_mae_dx": 0.07308841496706009,
      "pose_mae_dy": 0.04414001852273941,
      "pose_rmse_dtheta": 0.48869627714157104,
      "pose_rmse_dx": 0.15723223984241486,
      "pose_rmse_dy": 0.08205839991569519,
      "pose_rmse_mean": 0.24266231060028076,
      "rmse_dtheta": 0.04975534602999687,
      "rmse_dx": 0.02179679274559021,
      "rmse_dy": 0.004626864567399025,
      "rmse_mean": 0.02539300173521042,
      "rotation_flip": 0.01592356711626053,
      "sparse_tokens": 6212.0,
      "step": 8483,
      "turn_loss": 0.20264780521392822,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.39416465341014684,
      "grad_norm": 0.4412001073360443,
      "learning_rate": 2.0110262335202956e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.01376876886934042,
      "mae_dx": 0.003123002592474222,
      "mae_dy": 0.0037412522360682487,
      "pose_mae_dtheta": 0.09674070030450821,
      "pose_mae_dx": 0.025968071073293686,
      "pose_mae_dy": 0.03055214136838913,
      "pose_rmse_dtheta": 0.22670011222362518,
      "pose_rmse_dx": 0.06922611594200134,
      "pose_rmse_dy": 0.07161731272935867,
      "pose_rmse_mean": 0.122514508664608,
      "rmse_dtheta": 0.029795849695801735,
      "rmse_dx": 0.0098821260035038,
      "rmse_dy": 0.008832244202494621,
      "rmse_mean": 0.0161700751632452,
      "rotation_flip": 0.008123790845274925,
      "sparse_tokens": 32057.0,
      "step": 8484,
      "turn_loss": 0.12485064566135406,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.3942111131759896,
      "grad_norm": 0.3905857503414154,
      "learning_rate": 2.009966382140606e-06,
      "loss": 0.0855,
      "mae_dtheta": 0.02267344668507576,
      "mae_dx": 0.00473895575851202,
      "mae_dy": 0.004848356358706951,
      "pose_mae_dtheta": 0.16491839289665222,
      "pose_mae_dx": 0.03844395652413368,
      "pose_mae_dy": 0.05860453471541405,
      "pose_rmse_dtheta": 0.30189841985702515,
      "pose_rmse_dx": 0.08493075519800186,
      "pose_rmse_dy": 0.1224338635802269,
      "pose_rmse_mean": 0.16975435614585876,
      "rmse_dtheta": 0.03935187682509422,
      "rmse_dx": 0.012377476319670677,
      "rmse_dy": 0.009263675659894943,
      "rmse_mean": 0.020331010222434998,
      "rotation_flip": 0.017031630501151085,
      "sparse_tokens": 7613.0,
      "step": 8485,
      "turn_loss": 0.16032221913337708,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.3942575729418324,
      "grad_norm": 0.4483863413333893,
      "learning_rate": 2.0089067398555697e-06,
      "loss": 0.129,
      "mae_dtheta": 0.04038380831480026,
      "mae_dx": 0.012348760850727558,
      "mae_dy": 0.007494665216654539,
      "pose_mae_dtheta": 0.3036702573299408,
      "pose_mae_dx": 0.10187394917011261,
      "pose_mae_dy": 0.08426700532436371,
      "pose_rmse_dtheta": 0.5591428279876709,
      "pose_rmse_dx": 0.21801261603832245,
      "pose_rmse_dy": 0.20863519608974457,
      "pose_rmse_mean": 0.32859688997268677,
      "rmse_dtheta": 0.06099662929773331,
      "rmse_dx": 0.024108780547976494,
      "rmse_dy": 0.018466591835021973,
      "rmse_mean": 0.03452400118112564,
      "rotation_flip": 0.01157184224575758,
      "sparse_tokens": 17188.0,
      "step": 8486,
      "turn_loss": 0.40056854486465454,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.39430403270767517,
      "grad_norm": 1.141794204711914,
      "learning_rate": 2.007847306739293e-06,
      "loss": 0.2404,
      "mae_dtheta": 0.03908732160925865,
      "mae_dx": 0.016062714159488678,
      "mae_dy": 0.0083024175837636,
      "pose_mae_dtheta": 0.32877737283706665,
      "pose_mae_dx": 0.13252504169940948,
      "pose_mae_dy": 0.10152134299278259,
      "pose_rmse_dtheta": 0.5828915238380432,
      "pose_rmse_dx": 0.2857585847377777,
      "pose_rmse_dy": 0.27775877714157104,
      "pose_rmse_mean": 0.3821362853050232,
      "rmse_dtheta": 0.059500500559806824,
      "rmse_dx": 0.029377833008766174,
      "rmse_dy": 0.019594267010688782,
      "rmse_mean": 0.03615753352642059,
      "rotation_flip": 0.012867647223174572,
      "sparse_tokens": 9217.0,
      "step": 8487,
      "turn_loss": 0.3143252730369568,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.39435049247351794,
      "grad_norm": 0.6812657117843628,
      "learning_rate": 2.0067880828658576e-06,
      "loss": 0.1793,
      "mae_dtheta": 0.0345248244702816,
      "mae_dx": 0.013902080245316029,
      "mae_dy": 0.005424234550446272,
      "pose_mae_dtheta": 0.2865728437900543,
      "pose_mae_dx": 0.11126243323087692,
      "pose_mae_dy": 0.06833343952894211,
      "pose_rmse_dtheta": 0.49565696716308594,
      "pose_rmse_dx": 0.23918183147907257,
      "pose_rmse_dy": 0.14887118339538574,
      "pose_rmse_mean": 0.2945699989795685,
      "rmse_dtheta": 0.051096197217702866,
      "rmse_dx": 0.027018895372748375,
      "rmse_dy": 0.010416432283818722,
      "rmse_mean": 0.029510509222745895,
      "rotation_flip": 0.012081784196197987,
      "sparse_tokens": 19622.0,
      "step": 8488,
      "turn_loss": 0.2842448353767395,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3943969522393607,
      "grad_norm": 0.5016047358512878,
      "learning_rate": 2.0057290683093404e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.006267264951020479,
      "mae_dx": 0.001037369016557932,
      "mae_dy": 0.0002308536204509437,
      "pose_mae_dtheta": 0.04577769339084625,
      "pose_mae_dx": 0.007874313741922379,
      "pose_mae_dy": 0.0030207198578864336,
      "pose_rmse_dtheta": 0.22308431565761566,
      "pose_rmse_dx": 0.016207892447710037,
      "pose_rmse_dy": 0.006637056358158588,
      "pose_rmse_mean": 0.08197642117738724,
      "rmse_dtheta": 0.025982635095715523,
      "rmse_dx": 0.0026912428438663483,
      "rmse_dy": 0.0004817304143216461,
      "rmse_mean": 0.009718536399304867,
      "rotation_flip": 0.001291155582293868,
      "sparse_tokens": 32201.0,
      "step": 8489,
      "turn_loss": 0.036838263273239136,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.3944434120052035,
      "grad_norm": 0.5688937306404114,
      "learning_rate": 2.0046702631437947e-06,
      "loss": 0.1774,
      "mae_dtheta": 0.03500337898731232,
      "mae_dx": 0.014879560098052025,
      "mae_dy": 0.004864715971052647,
      "pose_mae_dtheta": 0.2890225648880005,
      "pose_mae_dx": 0.13202732801437378,
      "pose_mae_dy": 0.07116503268480301,
      "pose_rmse_dtheta": 0.5208131074905396,
      "pose_rmse_dx": 0.2801232933998108,
      "pose_rmse_dy": 0.13807962834835052,
      "pose_rmse_mean": 0.31300535798072815,
      "rmse_dtheta": 0.05278685316443443,
      "rmse_dx": 0.02919940836727619,
      "rmse_dy": 0.008434811607003212,
      "rmse_mean": 0.030140358954668045,
      "rotation_flip": 0.017921147868037224,
      "sparse_tokens": 15037.0,
      "step": 8490,
      "turn_loss": 0.2326706200838089,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3944898717710463,
      "grad_norm": 0.555355966091156,
      "learning_rate": 2.0036116674432653e-06,
      "loss": 0.1338,
      "mae_dtheta": 0.007582948077470064,
      "mae_dx": 0.003940647002309561,
      "mae_dy": 0.0006593538564629853,
      "pose_mae_dtheta": 0.05123654752969742,
      "pose_mae_dx": 0.03583789989352226,
      "pose_mae_dy": 0.008285530842840672,
      "pose_rmse_dtheta": 0.21577687561511993,
      "pose_rmse_dx": 0.1134951114654541,
      "pose_rmse_dy": 0.032595206052064896,
      "pose_rmse_mean": 0.12062239646911621,
      "rmse_dtheta": 0.026981426402926445,
      "rmse_dx": 0.012186258099973202,
      "rmse_dy": 0.001812684116885066,
      "rmse_mean": 0.013660123571753502,
      "rotation_flip": 0.0,
      "sparse_tokens": 32185.0,
      "step": 8491,
      "turn_loss": 0.11549174785614014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.39453633153688905,
      "grad_norm": 0.5231955647468567,
      "learning_rate": 2.002553281281782e-06,
      "loss": 0.1214,
      "mae_dtheta": 0.010710951872169971,
      "mae_dx": 0.001491664326749742,
      "mae_dy": 0.001680532586760819,
      "pose_mae_dtheta": 0.07002592086791992,
      "pose_mae_dx": 0.015717312693595886,
      "pose_mae_dy": 0.024563562124967575,
      "pose_rmse_dtheta": 0.17637838423252106,
      "pose_rmse_dx": 0.03848382085561752,
      "pose_rmse_dy": 0.051280729472637177,
      "pose_rmse_mean": 0.08871431648731232,
      "rmse_dtheta": 0.02252156473696232,
      "rmse_dx": 0.005057173781096935,
      "rmse_dy": 0.0032000623177736998,
      "rmse_mean": 0.010259600356221199,
      "rotation_flip": 0.005222981330007315,
      "sparse_tokens": 32089.0,
      "step": 8492,
      "turn_loss": 0.07070957869291306,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37522.0,
      "epoch": 0.39458279130273183,
      "grad_norm": 0.7266203761100769,
      "learning_rate": 2.0014951047333546e-06,
      "loss": 0.2054,
      "mae_dtheta": 0.034923240542411804,
      "mae_dx": 0.014128204435110092,
      "mae_dy": 0.005922599695622921,
      "pose_mae_dtheta": 0.2729926109313965,
      "pose_mae_dx": 0.10891547054052353,
      "pose_mae_dy": 0.06470630317926407,
      "pose_rmse_dtheta": 0.473392516374588,
      "pose_rmse_dx": 0.23853348195552826,
      "pose_rmse_dy": 0.14916332066059113,
      "pose_rmse_mean": 0.28702977299690247,
      "rmse_dtheta": 0.05233069881796837,
      "rmse_dx": 0.027346890419721603,
      "rmse_dy": 0.011441515758633614,
      "rmse_mean": 0.03037303499877453,
      "rotation_flip": 0.010602678172290325,
      "sparse_tokens": 29722.0,
      "step": 8493,
      "turn_loss": 0.3097785413265228,
      "turns": 116.0,
      "turns_per_sample": 116.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3946292510685746,
      "grad_norm": 0.40698477625846863,
      "learning_rate": 2.000437137871986e-06,
      "loss": 0.0745,
      "mae_dtheta": 0.007581288926303387,
      "mae_dx": 0.0014425937552005053,
      "mae_dy": 0.0014355966122820973,
      "pose_mae_dtheta": 0.05213123559951782,
      "pose_mae_dx": 0.014890161342918873,
      "pose_mae_dy": 0.01503504067659378,
      "pose_rmse_dtheta": 0.17973951995372772,
      "pose_rmse_dx": 0.04141708463430405,
      "pose_rmse_dy": 0.05295521020889282,
      "pose_rmse_mean": 0.0913706049323082,
      "rmse_dtheta": 0.022439802065491676,
      "rmse_dx": 0.004344886168837547,
      "rmse_dy": 0.004189526196569204,
      "rmse_mean": 0.010324738919734955,
      "rotation_flip": 0.0069135804660618305,
      "sparse_tokens": 32153.0,
      "step": 8494,
      "turn_loss": 0.05787615478038788,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17861.0,
      "epoch": 0.3946757108344174,
      "grad_norm": 0.786238968372345,
      "learning_rate": 1.9993793807716568e-06,
      "loss": 0.2383,
      "mae_dtheta": 0.03033481538295746,
      "mae_dx": 0.006761397235095501,
      "mae_dy": 0.0029327222146093845,
      "pose_mae_dtheta": 0.211203470826149,
      "pose_mae_dx": 0.046066250652074814,
      "pose_mae_dy": 0.030908498913049698,
      "pose_rmse_dtheta": 0.43388935923576355,
      "pose_rmse_dx": 0.10675200819969177,
      "pose_rmse_dy": 0.08496556431055069,
      "pose_rmse_mean": 0.20853565633296967,
      "rmse_dtheta": 0.05179029330611229,
      "rmse_dx": 0.01596551015973091,
      "rmse_dy": 0.006810737308114767,
      "rmse_mean": 0.024855514988303185,
      "rotation_flip": 0.008928571827709675,
      "sparse_tokens": 14513.0,
      "step": 8495,
      "turn_loss": 0.19686628878116608,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.39472217060026016,
      "grad_norm": 0.44164517521858215,
      "learning_rate": 1.9983218335063376e-06,
      "loss": 0.0878,
      "mae_dtheta": 0.03281467780470848,
      "mae_dx": 0.007801875937730074,
      "mae_dy": 0.0032014972530305386,
      "pose_mae_dtheta": 0.29003220796585083,
      "pose_mae_dx": 0.07263080775737762,
      "pose_mae_dy": 0.03222690895199776,
      "pose_rmse_dtheta": 0.5056682825088501,
      "pose_rmse_dx": 0.16401447355747223,
      "pose_rmse_dy": 0.07186295837163925,
      "pose_rmse_mean": 0.24718189239501953,
      "rmse_dtheta": 0.05268634110689163,
      "rmse_dx": 0.01782792992889881,
      "rmse_dy": 0.006530813407152891,
      "rmse_mean": 0.025681694969534874,
      "rotation_flip": 0.009975062683224678,
      "sparse_tokens": 6380.0,
      "step": 8496,
      "turn_loss": 0.25844475626945496,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.39476863036610294,
      "grad_norm": 0.5665460824966431,
      "learning_rate": 1.9972644961499853e-06,
      "loss": 0.1657,
      "mae_dtheta": 0.010472136549651623,
      "mae_dx": 0.0012539855670183897,
      "mae_dy": 0.0022090019192546606,
      "pose_mae_dtheta": 0.06686289608478546,
      "pose_mae_dx": 0.018620211631059647,
      "pose_mae_dy": 0.025733541697263718,
      "pose_rmse_dtheta": 0.1746317744255066,
      "pose_rmse_dx": 0.042230747640132904,
      "pose_rmse_dy": 0.05065302923321724,
      "pose_rmse_mean": 0.08917185664176941,
      "rmse_dtheta": 0.022600427269935608,
      "rmse_dx": 0.003516273805871606,
      "rmse_dy": 0.004183276556432247,
      "rmse_mean": 0.010099992156028748,
      "rotation_flip": 0.0032409075647592545,
      "sparse_tokens": 32057.0,
      "step": 8497,
      "turn_loss": 0.07708786427974701,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3948150901319457,
      "grad_norm": 0.33848902583122253,
      "learning_rate": 1.996207368776537e-06,
      "loss": 0.0632,
      "mae_dtheta": 0.007252494338899851,
      "mae_dx": 0.0014212351525202394,
      "mae_dy": 0.001580002368427813,
      "pose_mae_dtheta": 0.05046819895505905,
      "pose_mae_dx": 0.01649511605501175,
      "pose_mae_dy": 0.020019439980387688,
      "pose_rmse_dtheta": 0.11178048700094223,
      "pose_rmse_dx": 0.038882993161678314,
      "pose_rmse_dy": 0.05447879061102867,
      "pose_rmse_mean": 0.06838075816631317,
      "rmse_dtheta": 0.01550193689763546,
      "rmse_dx": 0.0038511522579938173,
      "rmse_dy": 0.0035592406056821346,
      "rmse_mean": 0.007637443952262402,
      "rotation_flip": 0.005900728981941938,
      "sparse_tokens": 32201.0,
      "step": 8498,
      "turn_loss": 0.05325738340616226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.3948615498977885,
      "grad_norm": 0.4137815535068512,
      "learning_rate": 1.9951504514599214e-06,
      "loss": 0.0821,
      "mae_dtheta": 0.05365750938653946,
      "mae_dx": 0.016494635492563248,
      "mae_dy": 0.0052026258781552315,
      "pose_mae_dtheta": 0.4518263041973114,
      "pose_mae_dx": 0.11566471308469772,
      "pose_mae_dy": 0.08723324537277222,
      "pose_rmse_dtheta": 0.6896758079528809,
      "pose_rmse_dx": 0.23676863312721252,
      "pose_rmse_dy": 0.17436157166957855,
      "pose_rmse_mean": 0.3669353425502777,
      "rmse_dtheta": 0.07141716778278351,
      "rmse_dx": 0.030601317062973976,
      "rmse_dy": 0.009147197008132935,
      "rmse_mean": 0.037055227905511856,
      "rotation_flip": 0.03162055462598801,
      "sparse_tokens": 4402.0,
      "step": 8499,
      "turn_loss": 0.39135998487472534,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.3949080096636313,
      "grad_norm": 1.0992933511734009,
      "learning_rate": 1.9940937442740455e-06,
      "loss": 0.2958,
      "mae_dtheta": 0.035674311220645905,
      "mae_dx": 0.014861545525491238,
      "mae_dy": 0.005632655695080757,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999991059303284,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 135.61512756347656,
      "model/head/act_norm_mean": 103.83893453663794,
      "model/head/act_norm_min": 75.6518783569336,
      "model/head/act_over_embed": 71.35908796899928,
      "model/head/grad_frac": 0.11523044109344482,
      "model/head/grad_norm": 0.11523033678531647,
      "model/head/grad_zero_frac": 0.00017989308980759233,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7019127155172413,
      "model/head/update_ratio": 0.0019627094734460115,
      "model/head/weight_delta": 9.780476570129395,
      "model/head/weight_delta_rel": 0.1715785264968872,
      "model/head/weight_norm": 58.7098274230957,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223025143146515,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4223025143146515,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4223025143146515,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29021024149545843,
      "model/modality_embedder.encoders.pose/grad_frac": 0.027516234666109085,
      "model/modality_embedder.encoders.pose/grad_norm": 0.027516210451722145,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0008885464048944414,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1194779872894287,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10192307084798813,
      "model/modality_embedder.encoders.pose/weight_norm": 30.967668533325195,
      "model/modality_embedder/grad_frac": 0.027516234666109085,
      "model/modality_embedder/grad_norm": 0.027516210451722145,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0008885464048944414,
      "model/modality_embedder/weight_delta": 3.1194779872894287,
      "model/modality_embedder/weight_delta_rel": 0.10192307084798813,
      "model/modality_embedder/weight_norm": 30.967668533325195,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 70.25747680664062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.01013871784346,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.126694679260254,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.812782751214769,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.12189781665802002,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.12189770489931107,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00012608940596692264,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.004363138694316149,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6393675804138184,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09618014842271805,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.938077926635742,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 71.59111785888672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.80603448275862,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.71073055267334,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.359729772158012,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.13251672685146332,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.13251660764217377,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.004456724971532822,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.347266435623169,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11595192551612854,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.73407745361328,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 72.94746398925781,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.374623700054734,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.980788230895996,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.43767896764753,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11760120838880539,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.11760110408067703,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0038303127512335777,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6206085681915283,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12157325446605682,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.702741622924805,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 73.36976623535156,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.240190544608648,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.523465156555176,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.719713968936954,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.10837314277887344,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.10837304592132568,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.003621490206569433,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1049892902374268,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10611379891633987,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.924985885620117,
      "model/normalizer/grad_frac": 0.45334646105766296,
      "model/normalizer/grad_norm": 0.45334604382514954,
      "model/normalizer/grad_zero_frac": 0.0001607164304004982,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.005766536574810743,
      "model/normalizer/weight_delta": 6.545762538909912,
      "model/normalizer/weight_delta_rel": 0.08430562913417816,
      "model/normalizer/weight_norm": 78.61669158935547,
      "pose_mae_dtheta": 0.2738863229751587,
      "pose_mae_dx": 0.14464104175567627,
      "pose_mae_dy": 0.07406125962734222,
      "pose_rmse_dtheta": 0.4534742534160614,
      "pose_rmse_dx": 0.29197487235069275,
      "pose_rmse_dy": 0.16625790297985077,
      "pose_rmse_mean": 0.30390235781669617,
      "rmse_dtheta": 0.05039088428020477,
      "rmse_dx": 0.028050247579813004,
      "rmse_dy": 0.00966600514948368,
      "rmse_mean": 0.029369045048952103,
      "rotation_flip": 0.014999999664723873,
      "sparse_tokens": 14274.0,
      "step": 8500,
      "turn_loss": 0.2965988218784332,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.3949544694294741,
      "grad_norm": 0.7002542614936829,
      "learning_rate": 1.9930372472928095e-06,
      "loss": 0.1832,
      "mae_dtheta": 0.04238736256957054,
      "mae_dx": 0.019931185990571976,
      "mae_dy": 0.0024474011734128,
      "pose_mae_dtheta": 0.33467915654182434,
      "pose_mae_dx": 0.14082570374011993,
      "pose_mae_dy": 0.0323447659611702,
      "pose_rmse_dtheta": 0.5063683986663818,
      "pose_rmse_dx": 0.29664772748947144,
      "pose_rmse_dy": 0.06419014185667038,
      "pose_rmse_mean": 0.2890687584877014,
      "rmse_dtheta": 0.05581759288907051,
      "rmse_dx": 0.0321158803999424,
      "rmse_dy": 0.005109691526740789,
      "rmse_mean": 0.03101438842713833,
      "rotation_flip": 0.018099548295140266,
      "sparse_tokens": 3924.0,
      "step": 8501,
      "turn_loss": 0.28056588768959045,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.3950009291953169,
      "grad_norm": 0.3678828477859497,
      "learning_rate": 1.9919809605900907e-06,
      "loss": 0.1011,
      "mae_dtheta": 0.035567667335271835,
      "mae_dx": 0.019293589517474174,
      "mae_dy": 0.00919046439230442,
      "pose_mae_dtheta": 0.2713557481765747,
      "pose_mae_dx": 0.16542553901672363,
      "pose_mae_dy": 0.10414953529834747,
      "pose_rmse_dtheta": 0.42658719420433044,
      "pose_rmse_dx": 0.3143998980522156,
      "pose_rmse_dy": 0.19334308803081512,
      "pose_rmse_mean": 0.31144338846206665,
      "rmse_dtheta": 0.05089905858039856,
      "rmse_dx": 0.03246348351240158,
      "rmse_dy": 0.01598990149796009,
      "rmse_mean": 0.03311748057603836,
      "rotation_flip": 0.010494752787053585,
      "sparse_tokens": 10636.0,
      "step": 8502,
      "turn_loss": 0.420387864112854,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.39504738896115965,
      "grad_norm": 0.5233545899391174,
      "learning_rate": 1.990924884239758e-06,
      "loss": 0.0924,
      "mae_dtheta": 0.008323128335177898,
      "mae_dx": 0.001507554785348475,
      "mae_dy": 0.0013988279970362782,
      "pose_mae_dtheta": 0.05448455736041069,
      "pose_mae_dx": 0.017718365415930748,
      "pose_mae_dy": 0.02081388793885708,
      "pose_rmse_dtheta": 0.1415824145078659,
      "pose_rmse_dx": 0.05141780525445938,
      "pose_rmse_dy": 0.053099777549505234,
      "pose_rmse_mean": 0.08203333616256714,
      "rmse_dtheta": 0.019976239651441574,
      "rmse_dx": 0.005337903741747141,
      "rmse_dy": 0.003032529493793845,
      "rmse_mean": 0.009448891505599022,
      "rotation_flip": 0.004981884267181158,
      "sparse_tokens": 32105.0,
      "step": 8503,
      "turn_loss": 0.06172921136021614,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.39509384872700243,
      "grad_norm": 1.0983527898788452,
      "learning_rate": 1.989869018315665e-06,
      "loss": 0.2245,
      "mae_dtheta": 0.02990925870835781,
      "mae_dx": 0.014947080984711647,
      "mae_dy": 0.004101729020476341,
      "pose_mae_dtheta": 0.21503649652004242,
      "pose_mae_dx": 0.12983295321464539,
      "pose_mae_dy": 0.054430652409791946,
      "pose_rmse_dtheta": 0.3857392966747284,
      "pose_rmse_dx": 0.2932334840297699,
      "pose_rmse_dy": 0.10897457599639893,
      "pose_rmse_mean": 0.2626491189002991,
      "rmse_dtheta": 0.0488014742732048,
      "rmse_dx": 0.030283547937870026,
      "rmse_dy": 0.007158819120377302,
      "rmse_mean": 0.02874794602394104,
      "rotation_flip": 0.021113242954015732,
      "sparse_tokens": 8885.0,
      "step": 8504,
      "turn_loss": 0.2924095094203949,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.3951403084928452,
      "grad_norm": 0.581430971622467,
      "learning_rate": 1.9888133628916456e-06,
      "loss": 0.1328,
      "mae_dtheta": 0.024439489468932152,
      "mae_dx": 0.011327429674565792,
      "mae_dy": 0.004231635481119156,
      "pose_mae_dtheta": 0.18850407004356384,
      "pose_mae_dx": 0.09088825434446335,
      "pose_mae_dy": 0.06135985627770424,
      "pose_rmse_dtheta": 0.36721277236938477,
      "pose_rmse_dx": 0.21128113567829132,
      "pose_rmse_dy": 0.1346254199743271,
      "pose_rmse_mean": 0.23770645260810852,
      "rmse_dtheta": 0.03976002708077431,
      "rmse_dx": 0.023783786222338676,
      "rmse_dy": 0.007847516797482967,
      "rmse_mean": 0.023797109723091125,
      "rotation_flip": 0.009162303991615772,
      "sparse_tokens": 14845.0,
      "step": 8505,
      "turn_loss": 0.24190905690193176,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.395186768258688,
      "grad_norm": 0.5188471674919128,
      "learning_rate": 1.9877579180415252e-06,
      "loss": 0.1306,
      "mae_dtheta": 0.011803661473095417,
      "mae_dx": 0.0017497778171673417,
      "mae_dy": 0.002166022779420018,
      "pose_mae_dtheta": 0.083406962454319,
      "pose_mae_dx": 0.02228405885398388,
      "pose_mae_dy": 0.0257608350366354,
      "pose_rmse_dtheta": 0.21606755256652832,
      "pose_rmse_dx": 0.05395504832267761,
      "pose_rmse_dy": 0.06318607181310654,
      "pose_rmse_mean": 0.11106956005096436,
      "rmse_dtheta": 0.025496868416666985,
      "rmse_dx": 0.004819497466087341,
      "rmse_dy": 0.0048903063870966434,
      "rmse_mean": 0.011735557578504086,
      "rotation_flip": 0.003834355855360627,
      "sparse_tokens": 32137.0,
      "step": 8506,
      "turn_loss": 0.08628382533788681,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.39523322802453076,
      "grad_norm": 0.3539702296257019,
      "learning_rate": 1.986702683839109e-06,
      "loss": 0.0642,
      "mae_dtheta": 0.008507193997502327,
      "mae_dx": 0.002195882610976696,
      "mae_dy": 0.0013352063251659274,
      "pose_mae_dtheta": 0.06130281463265419,
      "pose_mae_dx": 0.02250172756612301,
      "pose_mae_dy": 0.019222911447286606,
      "pose_rmse_dtheta": 0.19347719848155975,
      "pose_rmse_dx": 0.06122826039791107,
      "pose_rmse_dy": 0.049331437796354294,
      "pose_rmse_mean": 0.10134562849998474,
      "rmse_dtheta": 0.02259858138859272,
      "rmse_dx": 0.007138567045331001,
      "rmse_dy": 0.0030694250017404556,
      "rmse_mean": 0.0109355254098773,
      "rotation_flip": 0.0034227038267999887,
      "sparse_tokens": 32089.0,
      "step": 8507,
      "turn_loss": 0.07956267893314362,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9761.0,
      "epoch": 0.39527968779037354,
      "grad_norm": 0.4322860836982727,
      "learning_rate": 1.985647660358193e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.039683423936367035,
      "mae_dx": 0.014150031842291355,
      "mae_dy": 0.0051478673703968525,
      "pose_mae_dtheta": 0.3192984461784363,
      "pose_mae_dx": 0.11445309966802597,
      "pose_mae_dy": 0.06480441242456436,
      "pose_rmse_dtheta": 0.5800804495811462,
      "pose_rmse_dx": 0.24888840317726135,
      "pose_rmse_dy": 0.1534101516008377,
      "pose_rmse_mean": 0.3274596929550171,
      "rmse_dtheta": 0.06096603348851204,
      "rmse_dx": 0.02716679312288761,
      "rmse_dy": 0.010167937725782394,
      "rmse_mean": 0.0327669233083725,
      "rotation_flip": 0.010080644860863686,
      "sparse_tokens": 8205.0,
      "step": 8508,
      "turn_loss": 0.2598359286785126,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3953261475562163,
      "grad_norm": 0.5749421119689941,
      "learning_rate": 1.9845928476725522e-06,
      "loss": 0.1401,
      "mae_dtheta": 0.006616249214857817,
      "mae_dx": 0.001788976602256298,
      "mae_dy": 0.001863907091319561,
      "pose_mae_dtheta": 0.042627349495887756,
      "pose_mae_dx": 0.018834536895155907,
      "pose_mae_dy": 0.02214149385690689,
      "pose_rmse_dtheta": 0.08161165565252304,
      "pose_rmse_dx": 0.04637819156050682,
      "pose_rmse_dy": 0.056866057217121124,
      "pose_rmse_mean": 0.061618637293577194,
      "rmse_dtheta": 0.013322332873940468,
      "rmse_dx": 0.005369437392801046,
      "rmse_dy": 0.004355672746896744,
      "rmse_mean": 0.007682481314986944,
      "rotation_flip": 0.002373417606577277,
      "sparse_tokens": 32153.0,
      "step": 8509,
      "turn_loss": 0.06826753169298172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3953726073220591,
      "grad_norm": 0.36857178807258606,
      "learning_rate": 1.9835382458559525e-06,
      "loss": 0.0883,
      "mae_dtheta": 0.00903881061822176,
      "mae_dx": 0.0018111438257619739,
      "mae_dy": 0.0026652063243091106,
      "pose_mae_dtheta": 0.06271426379680634,
      "pose_mae_dx": 0.02224460430443287,
      "pose_mae_dy": 0.024180736392736435,
      "pose_rmse_dtheta": 0.19703496992588043,
      "pose_rmse_dx": 0.06516136229038239,
      "pose_rmse_dy": 0.059414200484752655,
      "pose_rmse_mean": 0.10720351338386536,
      "rmse_dtheta": 0.024341212585568428,
      "rmse_dx": 0.006918665021657944,
      "rmse_dy": 0.0071986946277320385,
      "rmse_mean": 0.012819524854421616,
      "rotation_flip": 0.0036463080905377865,
      "sparse_tokens": 32073.0,
      "step": 8510,
      "turn_loss": 0.0820842832326889,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64409.0,
      "epoch": 0.39541906708790187,
      "grad_norm": 0.4442300796508789,
      "learning_rate": 1.9824838549821433e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.009795630350708961,
      "mae_dx": 0.003957043867558241,
      "mae_dy": 0.003114311723038554,
      "pose_mae_dtheta": 0.06402216106653214,
      "pose_mae_dx": 0.04103919118642807,
      "pose_mae_dy": 0.029767485335469246,
      "pose_rmse_dtheta": 0.15769976377487183,
      "pose_rmse_dx": 0.13688036799430847,
      "pose_rmse_dy": 0.10060666501522064,
      "pose_rmse_mean": 0.13172893226146698,
      "rmse_dtheta": 0.021590860560536385,
      "rmse_dx": 0.012549345381557941,
      "rmse_dy": 0.009995662607252598,
      "rmse_mean": 0.0147119564935565,
      "rotation_flip": 0.003298515686765313,
      "sparse_tokens": 32009.0,
      "step": 8511,
      "turn_loss": 0.13429376482963562,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.39546552685374464,
      "grad_norm": 0.507770299911499,
      "learning_rate": 1.981429675124857e-06,
      "loss": 0.1334,
      "mae_dtheta": 0.0327560156583786,
      "mae_dx": 0.012769022025167942,
      "mae_dy": 0.005212757736444473,
      "pose_mae_dtheta": 0.23843425512313843,
      "pose_mae_dx": 0.09221116453409195,
      "pose_mae_dy": 0.04785177856683731,
      "pose_rmse_dtheta": 0.37430325150489807,
      "pose_rmse_dx": 0.2088576704263687,
      "pose_rmse_dy": 0.11192026734352112,
      "pose_rmse_mean": 0.23169374465942383,
      "rmse_dtheta": 0.04620622470974922,
      "rmse_dx": 0.024401063099503517,
      "rmse_dy": 0.009770167991518974,
      "rmse_mean": 0.026792487129569054,
      "rotation_flip": 0.012441679835319519,
      "sparse_tokens": 10494.0,
      "step": 8512,
      "turn_loss": 0.34522101283073425,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.3955119866195874,
      "grad_norm": 0.47472116351127625,
      "learning_rate": 1.9803757063578146e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.010232682339847088,
      "mae_dx": 0.0015586426015943289,
      "mae_dy": 0.0019589366856962442,
      "pose_mae_dtheta": 0.06197245046496391,
      "pose_mae_dx": 0.01648777909576893,
      "pose_mae_dy": 0.024891044944524765,
      "pose_rmse_dtheta": 0.1532701849937439,
      "pose_rmse_dx": 0.03696802258491516,
      "pose_rmse_dy": 0.07804092764854431,
      "pose_rmse_mean": 0.08942638337612152,
      "rmse_dtheta": 0.022270873188972473,
      "rmse_dx": 0.004444709978997707,
      "rmse_dy": 0.004140019416809082,
      "rmse_mean": 0.010285201482474804,
      "rotation_flip": 0.00612036744132638,
      "sparse_tokens": 32185.0,
      "step": 8513,
      "turn_loss": 0.08428013324737549,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.3955584463854302,
      "grad_norm": 0.35093453526496887,
      "learning_rate": 1.9793219487547185e-06,
      "loss": 0.0785,
      "mae_dtheta": 0.02016528695821762,
      "mae_dx": 0.007794213015586138,
      "mae_dy": 0.0024331947788596153,
      "pose_mae_dtheta": 0.13833628594875336,
      "pose_mae_dx": 0.04649076983332634,
      "pose_mae_dy": 0.02600770816206932,
      "pose_rmse_dtheta": 0.3271516263484955,
      "pose_rmse_dx": 0.12396484613418579,
      "pose_rmse_dy": 0.0791262835264206,
      "pose_rmse_mean": 0.17674759030342102,
      "rmse_dtheta": 0.03884571045637131,
      "rmse_dx": 0.018639767542481422,
      "rmse_dy": 0.00672864867374301,
      "rmse_mean": 0.021404709666967392,
      "rotation_flip": 0.007978723384439945,
      "sparse_tokens": 6577.0,
      "step": 8514,
      "turn_loss": 0.14909280836582184,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.395604906151273,
      "grad_norm": 0.5154543519020081,
      "learning_rate": 1.9782684023892613e-06,
      "loss": 0.0828,
      "mae_dtheta": 0.005150855053216219,
      "mae_dx": 0.0007602056139148772,
      "mae_dy": 0.0011213300749659538,
      "pose_mae_dtheta": 0.03023950196802616,
      "pose_mae_dx": 0.00821883138269186,
      "pose_mae_dy": 0.01400002557784319,
      "pose_rmse_dtheta": 0.07349515706300735,
      "pose_rmse_dx": 0.02125578559935093,
      "pose_rmse_dy": 0.03339611738920212,
      "pose_rmse_mean": 0.04271569103002548,
      "rmse_dtheta": 0.013082806952297688,
      "rmse_dx": 0.002413370879366994,
      "rmse_dy": 0.002578228712081909,
      "rmse_mean": 0.006024802103638649,
      "rotation_flip": 0.0028409091755747795,
      "sparse_tokens": 32057.0,
      "step": 8515,
      "turn_loss": 0.0409676618874073,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3956513659171158,
      "grad_norm": 0.6363265514373779,
      "learning_rate": 1.9772150673351146e-06,
      "loss": 0.151,
      "mae_dtheta": 0.010333296842873096,
      "mae_dx": 0.00252683088183403,
      "mae_dy": 0.0032020241487771273,
      "pose_mae_dtheta": 0.06998412311077118,
      "pose_mae_dx": 0.032546088099479675,
      "pose_mae_dy": 0.030484963208436966,
      "pose_rmse_dtheta": 0.16112279891967773,
      "pose_rmse_dx": 0.08019646257162094,
      "pose_rmse_dy": 0.06579583138227463,
      "pose_rmse_mean": 0.1023717075586319,
      "rmse_dtheta": 0.022061394527554512,
      "rmse_dx": 0.006863526068627834,
      "rmse_dy": 0.007457907311618328,
      "rmse_mean": 0.012127609923481941,
      "rotation_flip": 0.0035348180681467056,
      "sparse_tokens": 32105.0,
      "step": 8516,
      "turn_loss": 0.10323143750429153,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3956978256829586,
      "grad_norm": 0.40793442726135254,
      "learning_rate": 1.9761619436659427e-06,
      "loss": 0.1164,
      "mae_dtheta": 0.006318656262010336,
      "mae_dx": 0.0011996941175311804,
      "mae_dy": 0.0017522173002362251,
      "pose_mae_dtheta": 0.04383721575140953,
      "pose_mae_dx": 0.017047341912984848,
      "pose_mae_dy": 0.02389625832438469,
      "pose_rmse_dtheta": 0.0968484878540039,
      "pose_rmse_dx": 0.044907618314027786,
      "pose_rmse_dy": 0.06104940548539162,
      "pose_rmse_mean": 0.06760183721780777,
      "rmse_dtheta": 0.014593672938644886,
      "rmse_dx": 0.003515610471367836,
      "rmse_dy": 0.004222371615469456,
      "rmse_mean": 0.0074438853189349174,
      "rotation_flip": 0.004537953995168209,
      "sparse_tokens": 32089.0,
      "step": 8517,
      "turn_loss": 0.052869778126478195,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.39574428544880136,
      "grad_norm": 0.453468382358551,
      "learning_rate": 1.975109031455388e-06,
      "loss": 0.1284,
      "mae_dtheta": 0.034800540655851364,
      "mae_dx": 0.012563323602080345,
      "mae_dy": 0.003431080374866724,
      "pose_mae_dtheta": 0.25993937253952026,
      "pose_mae_dx": 0.10168258845806122,
      "pose_mae_dy": 0.05096695199608803,
      "pose_rmse_dtheta": 0.4398641884326935,
      "pose_rmse_dx": 0.2361706644296646,
      "pose_rmse_dy": 0.13809660077095032,
      "pose_rmse_mean": 0.27137717604637146,
      "rmse_dtheta": 0.05275936424732208,
      "rmse_dx": 0.02537364326417446,
      "rmse_dy": 0.007211640942841768,
      "rmse_mean": 0.02844821661710739,
      "rotation_flip": 0.014367816038429737,
      "sparse_tokens": 12884.0,
      "step": 8518,
      "turn_loss": 0.24497421085834503,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.39579074521464414,
      "grad_norm": 0.5810323357582092,
      "learning_rate": 1.9740563307770825e-06,
      "loss": 0.1076,
      "mae_dtheta": 0.009466120041906834,
      "mae_dx": 0.0025627599097788334,
      "mae_dy": 0.0023455952759832144,
      "pose_mae_dtheta": 0.06538878381252289,
      "pose_mae_dx": 0.028187299147248268,
      "pose_mae_dy": 0.026333380490541458,
      "pose_rmse_dtheta": 0.1628572642803192,
      "pose_rmse_dx": 0.09131808578968048,
      "pose_rmse_dy": 0.07238004356622696,
      "pose_rmse_mean": 0.10885180532932281,
      "rmse_dtheta": 0.022317489609122276,
      "rmse_dx": 0.008600409142673016,
      "rmse_dy": 0.0065415832214057446,
      "rmse_mean": 0.012486494146287441,
      "rotation_flip": 0.0037950663827359676,
      "sparse_tokens": 32089.0,
      "step": 8519,
      "turn_loss": 0.09118764847517014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11023.0,
      "epoch": 0.3958372049804869,
      "grad_norm": 0.44405725598335266,
      "learning_rate": 1.9730038417046415e-06,
      "loss": 0.0979,
      "mae_dtheta": 0.036147747188806534,
      "mae_dx": 0.012070509605109692,
      "mae_dy": 0.009714475832879543,
      "pose_mae_dtheta": 0.28814393281936646,
      "pose_mae_dx": 0.09504374861717224,
      "pose_mae_dy": 0.07968518882989883,
      "pose_rmse_dtheta": 0.5241001844406128,
      "pose_rmse_dx": 0.1983826756477356,
      "pose_rmse_dy": 0.17212963104248047,
      "pose_rmse_mean": 0.2982041835784912,
      "rmse_dtheta": 0.05526656657457352,
      "rmse_dx": 0.02295161969959736,
      "rmse_dy": 0.019659489393234253,
      "rmse_mean": 0.032625891268253326,
      "rotation_flip": 0.013108613900840282,
      "sparse_tokens": 9502.0,
      "step": 8520,
      "turn_loss": 0.25855210423469543,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3958836647463297,
      "grad_norm": 0.4568670690059662,
      "learning_rate": 1.971951564311668e-06,
      "loss": 0.0709,
      "mae_dtheta": 0.00687010632827878,
      "mae_dx": 0.0013716411776840687,
      "mae_dy": 0.001597721129655838,
      "pose_mae_dtheta": 0.045224644243717194,
      "pose_mae_dx": 0.010530396364629269,
      "pose_mae_dy": 0.016778770834207535,
      "pose_rmse_dtheta": 0.14044933021068573,
      "pose_rmse_dx": 0.028313012793660164,
      "pose_rmse_dy": 0.03706568479537964,
      "pose_rmse_mean": 0.0686093419790268,
      "rmse_dtheta": 0.016750438138842583,
      "rmse_dx": 0.005419750697910786,
      "rmse_dy": 0.005598485004156828,
      "rmse_mean": 0.00925622507929802,
      "rotation_flip": 0.0039093042723834515,
      "sparse_tokens": 32137.0,
      "step": 8521,
      "turn_loss": 0.06317923963069916,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.39593012451217247,
      "grad_norm": 0.5507451891899109,
      "learning_rate": 1.970899498671745e-06,
      "loss": 0.1061,
      "mae_dtheta": 0.03301277011632919,
      "mae_dx": 0.01436825841665268,
      "mae_dy": 0.005551666021347046,
      "pose_mae_dtheta": 0.24691647291183472,
      "pose_mae_dx": 0.10710133612155914,
      "pose_mae_dy": 0.06223496422171593,
      "pose_rmse_dtheta": 0.460006982088089,
      "pose_rmse_dx": 0.21869251132011414,
      "pose_rmse_dy": 0.18230217695236206,
      "pose_rmse_mean": 0.2870005667209625,
      "rmse_dtheta": 0.05422530695796013,
      "rmse_dx": 0.027225304394960403,
      "rmse_dy": 0.011728129349648952,
      "rmse_mean": 0.03105958178639412,
      "rotation_flip": 0.008080808445811272,
      "sparse_tokens": 8492.0,
      "step": 8522,
      "turn_loss": 0.2510215938091278,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.39597658427801524,
      "grad_norm": 0.3439008891582489,
      "learning_rate": 1.9698476448584474e-06,
      "loss": 0.0761,
      "mae_dtheta": 0.0042481799609959126,
      "mae_dx": 0.0009151400881819427,
      "mae_dy": 0.000911080336663872,
      "pose_mae_dtheta": 0.028295384719967842,
      "pose_mae_dx": 0.009683821350336075,
      "pose_mae_dy": 0.012620294466614723,
      "pose_rmse_dtheta": 0.0678459107875824,
      "pose_rmse_dx": 0.029218321666121483,
      "pose_rmse_dy": 0.030813688412308693,
      "pose_rmse_mean": 0.042625974863767624,
      "rmse_dtheta": 0.011635128408670425,
      "rmse_dx": 0.0034771482460200787,
      "rmse_dy": 0.001981086563318968,
      "rmse_mean": 0.005697788204997778,
      "rotation_flip": 0.0011621150188148022,
      "sparse_tokens": 32057.0,
      "step": 8523,
      "turn_loss": 0.03888479620218277,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.396023044043858,
      "grad_norm": 0.6623291373252869,
      "learning_rate": 1.9687960029453292e-06,
      "loss": 0.2055,
      "mae_dtheta": 0.01197794545441866,
      "mae_dx": 0.0021321196109056473,
      "mae_dy": 0.0028967394027858973,
      "pose_mae_dtheta": 0.0845232680439949,
      "pose_mae_dx": 0.02502983622252941,
      "pose_mae_dy": 0.030545569956302643,
      "pose_rmse_dtheta": 0.2008841335773468,
      "pose_rmse_dx": 0.0626838356256485,
      "pose_rmse_dy": 0.08209028095006943,
      "pose_rmse_mean": 0.11521942913532257,
      "rmse_dtheta": 0.026497576385736465,
      "rmse_dx": 0.006710752844810486,
      "rmse_dy": 0.007673483807593584,
      "rmse_mean": 0.013627271167933941,
      "rotation_flip": 0.005293005611747503,
      "sparse_tokens": 32137.0,
      "step": 8524,
      "turn_loss": 0.1086583212018013,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3960695038097008,
      "grad_norm": 0.43412792682647705,
      "learning_rate": 1.9677445730059348e-06,
      "loss": 0.0858,
      "mae_dtheta": 0.00965561531484127,
      "mae_dx": 0.0015205463860183954,
      "mae_dy": 0.00274924305267632,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4341278076171875,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.04617309570312,
      "model/head/act_norm_mean": 110.84601878156566,
      "model/head/act_norm_min": 56.122276306152344,
      "model/head/act_over_embed": 76.17442186346987,
      "model/head/grad_frac": 0.09789803624153137,
      "model/head/grad_norm": 0.04250026121735573,
      "model/head/grad_zero_frac": 0.00019766030891332775,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7099905303030303,
      "model/head/update_ratio": 0.0007238956750370562,
      "model/head/weight_delta": 9.784802436828613,
      "model/head/weight_delta_rel": 0.17165441811084747,
      "model/head/weight_norm": 58.710479736328125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223976135253906,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42231318038729476,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4222560524940491,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29021757132043624,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09695471823215485,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04209074005484581,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5214033698156681,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013591935858130455,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1183135509490967,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10188502073287964,
      "model/modality_embedder.encoders.pose/weight_norm": 30.967435836791992,
      "model/modality_embedder/grad_frac": 0.09695471823215485,
      "model/modality_embedder/grad_norm": 0.04209074005484581,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5214033698156681,
      "model/modality_embedder/update_ratio": 0.0013591935858130455,
      "model/modality_embedder/weight_delta": 3.1183135509490967,
      "model/modality_embedder/weight_delta_rel": 0.10188502073287964,
      "model/modality_embedder/weight_norm": 30.967435836791992,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.39203643798828,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.718464405964404,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.039926528930664,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.29955079554105,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07667164504528046,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.033285293728113174,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011913762427866459,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.641555070877075,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09625986218452454,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.93852424621582,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.23698425292969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.69292378146545,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.233426094055176,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.96920840141778,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07387245446443558,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.032070085406303406,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010785298654809594,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3498804569244385,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11604247987270355,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.73499870300293,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.30154418945312,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.531538099246433,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.367082595825195,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.232721373975316,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07361262291669846,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03195728734135628,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010408279486000538,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.623565196990967,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12167253345251083,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.703718185424805,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.89768981933594,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.277492183742183,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.295870780944824,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.43255736672047,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0641942098736763,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.027868492528796196,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009312549373134971,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.107404947280884,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10619635134935379,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.925739288330078,
      "model/normalizer/grad_frac": 0.2532106637954712,
      "model/normalizer/grad_norm": 0.1099257841706276,
      "model/normalizer/grad_zero_frac": 0.00019616857753135264,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0013982346281409264,
      "model/normalizer/weight_delta": 6.550935745239258,
      "model/normalizer/weight_delta_rel": 0.08437225967645645,
      "model/normalizer/weight_norm": 78.6175537109375,
      "pose_mae_dtheta": 0.06286541372537613,
      "pose_mae_dx": 0.02147102542221546,
      "pose_mae_dy": 0.03403874486684799,
      "pose_rmse_dtheta": 0.14750750362873077,
      "pose_rmse_dx": 0.06002895534038544,
      "pose_rmse_dy": 0.1036544144153595,
      "pose_rmse_mean": 0.10373029112815857,
      "rmse_dtheta": 0.021173832938075066,
      "rmse_dx": 0.005055994726717472,
      "rmse_dy": 0.008603247813880444,
      "rmse_mean": 0.011611025780439377,
      "rotation_flip": 0.005775210913270712,
      "sparse_tokens": 32057.0,
      "step": 8525,
      "turn_loss": 0.07192173600196838,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.3961159635755436,
      "grad_norm": 0.46505504846572876,
      "learning_rate": 1.9666933551137877e-06,
      "loss": 0.0965,
      "mae_dtheta": 0.007078573107719421,
      "mae_dx": 0.0010173536138609052,
      "mae_dy": 0.0014579416019842029,
      "pose_mae_dtheta": 0.049198515713214874,
      "pose_mae_dx": 0.014525623060762882,
      "pose_mae_dy": 0.020885946229100227,
      "pose_rmse_dtheta": 0.1286473423242569,
      "pose_rmse_dx": 0.045883968472480774,
      "pose_rmse_dy": 0.05603329464793205,
      "pose_rmse_mean": 0.07685486972332001,
      "rmse_dtheta": 0.017664488404989243,
      "rmse_dx": 0.0031570089049637318,
      "rmse_dy": 0.003617172595113516,
      "rmse_mean": 0.008146223612129688,
      "rotation_flip": 0.004512126557528973,
      "sparse_tokens": 32057.0,
      "step": 8526,
      "turn_loss": 0.05927029997110367,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.39616242334138635,
      "grad_norm": 0.4173244833946228,
      "learning_rate": 1.9656423493424047e-06,
      "loss": 0.1099,
      "mae_dtheta": 0.009861348196864128,
      "mae_dx": 0.0014677435392513871,
      "mae_dy": 0.0017870841547846794,
      "pose_mae_dtheta": 0.062359150499105453,
      "pose_mae_dx": 0.018819738179445267,
      "pose_mae_dy": 0.024059021845459938,
      "pose_rmse_dtheta": 0.13400045037269592,
      "pose_rmse_dx": 0.04382101818919182,
      "pose_rmse_dy": 0.05533380061388016,
      "pose_rmse_mean": 0.07771842926740646,
      "rmse_dtheta": 0.020533937960863113,
      "rmse_dx": 0.004439319018274546,
      "rmse_dy": 0.0035669682547450066,
      "rmse_mean": 0.009513407945632935,
      "rotation_flip": 0.002613890916109085,
      "sparse_tokens": 32153.0,
      "step": 8527,
      "turn_loss": 0.07569468021392822,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.3962088831072291,
      "grad_norm": 0.7563912868499756,
      "learning_rate": 1.9645915557652788e-06,
      "loss": 0.2634,
      "mae_dtheta": 0.03695489093661308,
      "mae_dx": 0.010769734159111977,
      "mae_dy": 0.004537625703960657,
      "pose_mae_dtheta": 0.2946820855140686,
      "pose_mae_dx": 0.08443117141723633,
      "pose_mae_dy": 0.04673726484179497,
      "pose_rmse_dtheta": 0.47653669118881226,
      "pose_rmse_dx": 0.17851027846336365,
      "pose_rmse_dy": 0.11785071343183517,
      "pose_rmse_mean": 0.2576325535774231,
      "rmse_dtheta": 0.052904240787029266,
      "rmse_dx": 0.021154124289751053,
      "rmse_dy": 0.012279373593628407,
      "rmse_mean": 0.028779249638319016,
      "rotation_flip": 0.016602810472249985,
      "sparse_tokens": 11462.0,
      "step": 8528,
      "turn_loss": 0.3028736114501953,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.3962553428730719,
      "grad_norm": 0.7194255590438843,
      "learning_rate": 1.9635409744558953e-06,
      "loss": 0.2126,
      "mae_dtheta": 0.0263887420296669,
      "mae_dx": 0.006019271444529295,
      "mae_dy": 0.003594539826735854,
      "pose_mae_dtheta": 0.20631462335586548,
      "pose_mae_dx": 0.05181586742401123,
      "pose_mae_dy": 0.046707939356565475,
      "pose_rmse_dtheta": 0.41108238697052,
      "pose_rmse_dx": 0.13829945027828217,
      "pose_rmse_dy": 0.12155880033969879,
      "pose_rmse_mean": 0.223646879196167,
      "rmse_dtheta": 0.04447369650006294,
      "rmse_dx": 0.01671977899968624,
      "rmse_dy": 0.0078879464417696,
      "rmse_mean": 0.023027140647172928,
      "rotation_flip": 0.008818342350423336,
      "sparse_tokens": 11328.0,
      "step": 8529,
      "turn_loss": 0.20579610764980316,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3963018026389147,
      "grad_norm": 0.3871302604675293,
      "learning_rate": 1.9624906054877224e-06,
      "loss": 0.0935,
      "mae_dtheta": 0.012847445905208588,
      "mae_dx": 0.0021075725089758635,
      "mae_dy": 0.0032906390260905027,
      "pose_mae_dtheta": 0.08714400231838226,
      "pose_mae_dx": 0.026534665375947952,
      "pose_mae_dy": 0.0331016406416893,
      "pose_rmse_dtheta": 0.2113138884305954,
      "pose_rmse_dx": 0.07348942756652832,
      "pose_rmse_dy": 0.08365612477064133,
      "pose_rmse_mean": 0.12281982600688934,
      "rmse_dtheta": 0.026552734896540642,
      "rmse_dx": 0.0063590724021196365,
      "rmse_dy": 0.008089113049209118,
      "rmse_mean": 0.013666974380612373,
      "rotation_flip": 0.005181347019970417,
      "sparse_tokens": 32153.0,
      "step": 8530,
      "turn_loss": 0.1105566918849945,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24663.0,
      "epoch": 0.39634826240475746,
      "grad_norm": 0.5998138189315796,
      "learning_rate": 1.9614404489342097e-06,
      "loss": 0.1613,
      "mae_dtheta": 0.027293076738715172,
      "mae_dx": 0.011114954017102718,
      "mae_dy": 0.00334954634308815,
      "pose_mae_dtheta": 0.1948080211877823,
      "pose_mae_dx": 0.08625417202711105,
      "pose_mae_dy": 0.03890713304281235,
      "pose_rmse_dtheta": 0.36692461371421814,
      "pose_rmse_dx": 0.2068396955728531,
      "pose_rmse_dy": 0.0948934406042099,
      "pose_rmse_mean": 0.22288593649864197,
      "rmse_dtheta": 0.04423115402460098,
      "rmse_dx": 0.024052388966083527,
      "rmse_dy": 0.006826956756412983,
      "rmse_mean": 0.025036834180355072,
      "rotation_flip": 0.011549566872417927,
      "sparse_tokens": 19543.0,
      "step": 8531,
      "turn_loss": 0.20581600069999695,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.39639472217060023,
      "grad_norm": 0.3587751090526581,
      "learning_rate": 1.9603905048687998e-06,
      "loss": 0.0751,
      "mae_dtheta": 0.009069502353668213,
      "mae_dx": 0.0014508013846352696,
      "mae_dy": 0.0017711659893393517,
      "pose_mae_dtheta": 0.06025204807519913,
      "pose_mae_dx": 0.016942383721470833,
      "pose_mae_dy": 0.023081915453076363,
      "pose_rmse_dtheta": 0.18016918003559113,
      "pose_rmse_dx": 0.050520069897174835,
      "pose_rmse_dy": 0.06255688518285751,
      "pose_rmse_mean": 0.09774871915578842,
      "rmse_dtheta": 0.02372427098453045,
      "rmse_dx": 0.0046131908893585205,
      "rmse_dy": 0.005008694250136614,
      "rmse_mean": 0.01111538615077734,
      "rotation_flip": 0.005337215028703213,
      "sparse_tokens": 32105.0,
      "step": 8532,
      "turn_loss": 0.07850734889507294,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.39644118193644307,
      "grad_norm": 0.7846193313598633,
      "learning_rate": 1.959340773364911e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.0071570659056305885,
      "mae_dx": 0.0016042322386056185,
      "mae_dy": 0.0020926599390804768,
      "pose_mae_dtheta": 0.048736028373241425,
      "pose_mae_dx": 0.017025981098413467,
      "pose_mae_dy": 0.02275075949728489,
      "pose_rmse_dtheta": 0.10108810663223267,
      "pose_rmse_dx": 0.0498647503554821,
      "pose_rmse_dy": 0.055451955646276474,
      "pose_rmse_mean": 0.06880161166191101,
      "rmse_dtheta": 0.01617351546883583,
      "rmse_dx": 0.004859480541199446,
      "rmse_dy": 0.005113971885293722,
      "rmse_mean": 0.008715656585991383,
      "rotation_flip": 0.00644901255145669,
      "sparse_tokens": 32089.0,
      "step": 8533,
      "turn_loss": 0.06823495030403137,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.39648764170228584,
      "grad_norm": 1.3640615940093994,
      "learning_rate": 1.958291254495954e-06,
      "loss": 0.2799,
      "mae_dtheta": 0.03423666954040527,
      "mae_dx": 0.008773471228778362,
      "mae_dy": 0.008544121868908405,
      "pose_mae_dtheta": 0.25553932785987854,
      "pose_mae_dx": 0.059088367968797684,
      "pose_mae_dy": 0.08483857661485672,
      "pose_rmse_dtheta": 0.4486311674118042,
      "pose_rmse_dx": 0.1198454275727272,
      "pose_rmse_dy": 0.18667839467525482,
      "pose_rmse_mean": 0.25171834230422974,
      "rmse_dtheta": 0.051524072885513306,
      "rmse_dx": 0.020170878618955612,
      "rmse_dy": 0.0172828808426857,
      "rmse_mean": 0.029659278690814972,
      "rotation_flip": 0.009313154965639114,
      "sparse_tokens": 15102.0,
      "step": 8534,
      "turn_loss": 0.24897420406341553,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3965341014681286,
      "grad_norm": 0.5472286939620972,
      "learning_rate": 1.9572419483353245e-06,
      "loss": 0.0988,
      "mae_dtheta": 0.00796996708959341,
      "mae_dx": 0.0013975829351693392,
      "mae_dy": 0.0017394842579960823,
      "pose_mae_dtheta": 0.05537496134638786,
      "pose_mae_dx": 0.01818927377462387,
      "pose_mae_dy": 0.02363145351409912,
      "pose_rmse_dtheta": 0.1514004021883011,
      "pose_rmse_dx": 0.06016303598880768,
      "pose_rmse_dy": 0.08508558571338654,
      "pose_rmse_mean": 0.0988830178976059,
      "rmse_dtheta": 0.019121957942843437,
      "rmse_dx": 0.00457514263689518,
      "rmse_dy": 0.004978003446012735,
      "rmse_mean": 0.009558368474245071,
      "rotation_flip": 0.005437469109892845,
      "sparse_tokens": 32073.0,
      "step": 8535,
      "turn_loss": 0.058801356703042984,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.3965805612339714,
      "grad_norm": 0.5589640140533447,
      "learning_rate": 1.956192854956397e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.013047310523688793,
      "mae_dx": 0.003016700502485037,
      "mae_dy": 0.003459959989413619,
      "pose_mae_dtheta": 0.09013430774211884,
      "pose_mae_dx": 0.037575967609882355,
      "pose_mae_dy": 0.04223627969622612,
      "pose_rmse_dtheta": 0.2060503512620926,
      "pose_rmse_dx": 0.11833783239126205,
      "pose_rmse_dy": 0.1023479700088501,
      "pose_rmse_mean": 0.14224538207054138,
      "rmse_dtheta": 0.026493040844798088,
      "rmse_dx": 0.009973271749913692,
      "rmse_dy": 0.008035839535295963,
      "rmse_mean": 0.014834050089120865,
      "rotation_flip": 0.006616673897951841,
      "sparse_tokens": 32041.0,
      "step": 8536,
      "turn_loss": 0.10756479203701019,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.3966270209998142,
      "grad_norm": 0.45571646094322205,
      "learning_rate": 1.955143974432538e-06,
      "loss": 0.1112,
      "mae_dtheta": 0.031331777572631836,
      "mae_dx": 0.011602777987718582,
      "mae_dy": 0.005568219348788261,
      "pose_mae_dtheta": 0.2419368177652359,
      "pose_mae_dx": 0.09420817345380783,
      "pose_mae_dy": 0.06860372424125671,
      "pose_rmse_dtheta": 0.42758816480636597,
      "pose_rmse_dx": 0.2147175520658493,
      "pose_rmse_dy": 0.1524524837732315,
      "pose_rmse_mean": 0.2649194002151489,
      "rmse_dtheta": 0.04897729679942131,
      "rmse_dx": 0.02455560490489006,
      "rmse_dy": 0.009692097082734108,
      "rmse_mean": 0.02774166688323021,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 17943.0,
      "step": 8537,
      "turn_loss": 0.2676178514957428,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 14899.0,
      "epoch": 0.39667348076565695,
      "grad_norm": 0.4496951401233673,
      "learning_rate": 1.9540953068370936e-06,
      "loss": 0.1172,
      "mae_dtheta": 0.03238750621676445,
      "mae_dx": 0.013439580798149109,
      "mae_dy": 0.007154248189181089,
      "pose_mae_dtheta": 0.2669101655483246,
      "pose_mae_dx": 0.11343251913785934,
      "pose_mae_dy": 0.09638241678476334,
      "pose_rmse_dtheta": 0.43947693705558777,
      "pose_rmse_dx": 0.23918725550174713,
      "pose_rmse_dy": 0.20420625805854797,
      "pose_rmse_mean": 0.294290155172348,
      "rmse_dtheta": 0.04699188098311424,
      "rmse_dx": 0.026537666097283363,
      "rmse_dy": 0.013478712178766727,
      "rmse_mean": 0.029002754017710686,
      "rotation_flip": 0.009036144241690636,
      "sparse_tokens": 12312.0,
      "step": 8538,
      "turn_loss": 0.2884366810321808,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3967199405314997,
      "grad_norm": 0.5178989768028259,
      "learning_rate": 1.953046852243401e-06,
      "loss": 0.115,
      "mae_dtheta": 0.008883324451744556,
      "mae_dx": 0.0013386664213612676,
      "mae_dy": 0.0019381981110200286,
      "pose_mae_dtheta": 0.060390621423721313,
      "pose_mae_dx": 0.01558656245470047,
      "pose_mae_dy": 0.023393414914608,
      "pose_rmse_dtheta": 0.16674888134002686,
      "pose_rmse_dx": 0.039098989218473434,
      "pose_rmse_dy": 0.052904024720191956,
      "pose_rmse_mean": 0.08625063300132751,
      "rmse_dtheta": 0.020255569368600845,
      "rmse_dx": 0.004574260208755732,
      "rmse_dy": 0.0039011184126138687,
      "rmse_mean": 0.009576982818543911,
      "rotation_flip": 0.008852964267134666,
      "sparse_tokens": 32105.0,
      "step": 8539,
      "turn_loss": 0.06705924868583679,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3967664002973425,
      "grad_norm": 0.656048059463501,
      "learning_rate": 1.9519986107247755e-06,
      "loss": 0.1041,
      "mae_dtheta": 0.009368360973894596,
      "mae_dx": 0.0019520728383213282,
      "mae_dy": 0.002305388916283846,
      "pose_mae_dtheta": 0.06629464775323868,
      "pose_mae_dx": 0.019308675080537796,
      "pose_mae_dy": 0.02537674829363823,
      "pose_rmse_dtheta": 0.13386335968971252,
      "pose_rmse_dx": 0.046196117997169495,
      "pose_rmse_dy": 0.05578712001442909,
      "pose_rmse_mean": 0.07861553132534027,
      "rmse_dtheta": 0.018825210630893707,
      "rmse_dx": 0.005532778333872557,
      "rmse_dy": 0.005757755599915981,
      "rmse_mean": 0.010038582608103752,
      "rotation_flip": 0.004465946927666664,
      "sparse_tokens": 32153.0,
      "step": 8540,
      "turn_loss": 0.08768505603075027,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.3968128600631853,
      "grad_norm": 0.5952237248420715,
      "learning_rate": 1.9509505823545232e-06,
      "loss": 0.1512,
      "mae_dtheta": 0.012486481107771397,
      "mae_dx": 0.0027747666463255882,
      "mae_dy": 0.004609360825270414,
      "pose_mae_dtheta": 0.08626274764537811,
      "pose_mae_dx": 0.03817901015281677,
      "pose_mae_dy": 0.03943853825330734,
      "pose_rmse_dtheta": 0.17148423194885254,
      "pose_rmse_dx": 0.09755196422338486,
      "pose_rmse_dy": 0.0908120796084404,
      "pose_rmse_mean": 0.11994943022727966,
      "rmse_dtheta": 0.023908305913209915,
      "rmse_dx": 0.007206347770988941,
      "rmse_dy": 0.010232673957943916,
      "rmse_mean": 0.01378244161605835,
      "rotation_flip": 0.006352390628308058,
      "sparse_tokens": 32137.0,
      "step": 8541,
      "turn_loss": 0.13620725274085999,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.39685931982902806,
      "grad_norm": 0.5809393525123596,
      "learning_rate": 1.949902767205935e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.037789247930049896,
      "mae_dx": 0.016027824953198433,
      "mae_dy": 0.012313003651797771,
      "pose_mae_dtheta": 0.3046058118343353,
      "pose_mae_dx": 0.13375437259674072,
      "pose_mae_dy": 0.14730055630207062,
      "pose_rmse_dtheta": 0.4834734797477722,
      "pose_rmse_dx": 0.2516174912452698,
      "pose_rmse_dy": 0.3268047571182251,
      "pose_rmse_mean": 0.35396525263786316,
      "rmse_dtheta": 0.0535246916115284,
      "rmse_dx": 0.02735135331749916,
      "rmse_dy": 0.022450542077422142,
      "rmse_mean": 0.034442197531461716,
      "rotation_flip": 0.006968641187995672,
      "sparse_tokens": 10668.0,
      "step": 8542,
      "turn_loss": 0.3901628255844116,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.39690577959487083,
      "grad_norm": 0.4713161289691925,
      "learning_rate": 1.948855165352282e-06,
      "loss": 0.0995,
      "mae_dtheta": 0.00866655446588993,
      "mae_dx": 0.0012955295387655497,
      "mae_dy": 0.002041018567979336,
      "pose_mae_dtheta": 0.056230124086141586,
      "pose_mae_dx": 0.01810610666871071,
      "pose_mae_dy": 0.028821593150496483,
      "pose_rmse_dtheta": 0.12247950583696365,
      "pose_rmse_dx": 0.052901741117239,
      "pose_rmse_dy": 0.074484683573246,
      "pose_rmse_mean": 0.08328863978385925,
      "rmse_dtheta": 0.01729360595345497,
      "rmse_dx": 0.0042151049710810184,
      "rmse_dy": 0.004402210935950279,
      "rmse_mean": 0.008636973798274994,
      "rotation_flip": 0.003878975985571742,
      "sparse_tokens": 32089.0,
      "step": 8543,
      "turn_loss": 0.07111652195453644,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21682.0,
      "epoch": 0.3969522393607136,
      "grad_norm": 0.778435468673706,
      "learning_rate": 1.9478077768668265e-06,
      "loss": 0.1947,
      "mae_dtheta": 0.035542186349630356,
      "mae_dx": 0.015469105914235115,
      "mae_dy": 0.005114581901580095,
      "pose_mae_dtheta": 0.27465149760246277,
      "pose_mae_dx": 0.12029087543487549,
      "pose_mae_dy": 0.05835061892867088,
      "pose_rmse_dtheta": 0.5034595131874084,
      "pose_rmse_dx": 0.27886903285980225,
      "pose_rmse_dy": 0.1373969167470932,
      "pose_rmse_mean": 0.3065751791000366,
      "rmse_dtheta": 0.05378282815217972,
      "rmse_dx": 0.029795562848448753,
      "rmse_dy": 0.010235369205474854,
      "rmse_mean": 0.031271256506443024,
      "rotation_flip": 0.01595214381814003,
      "sparse_tokens": 17328.0,
      "step": 8544,
      "turn_loss": 0.31245097517967224,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3969986991265564,
      "grad_norm": 0.6128412485122681,
      "learning_rate": 1.946760601822809e-06,
      "loss": 0.1165,
      "mae_dtheta": 0.008348540402948856,
      "mae_dx": 0.0014562570722773671,
      "mae_dy": 0.0024157532025128603,
      "pose_mae_dtheta": 0.05280566215515137,
      "pose_mae_dx": 0.01752198114991188,
      "pose_mae_dy": 0.026324478909373283,
      "pose_rmse_dtheta": 0.12500004470348358,
      "pose_rmse_dx": 0.05386396497488022,
      "pose_rmse_dy": 0.0823126882314682,
      "pose_rmse_mean": 0.0870589017868042,
      "rmse_dtheta": 0.019082950428128242,
      "rmse_dx": 0.004195075016468763,
      "rmse_dy": 0.007266348227858543,
      "rmse_mean": 0.010181458666920662,
      "rotation_flip": 0.006175380665808916,
      "sparse_tokens": 32121.0,
      "step": 8545,
      "turn_loss": 0.08919873833656311,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34607.0,
      "epoch": 0.39704515889239916,
      "grad_norm": 0.5995750427246094,
      "learning_rate": 1.945713640293464e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.03501315787434578,
      "mae_dx": 0.013915715739130974,
      "mae_dy": 0.005897508468478918,
      "pose_mae_dtheta": 0.2723926603794098,
      "pose_mae_dx": 0.10974784940481186,
      "pose_mae_dy": 0.07997901737689972,
      "pose_rmse_dtheta": 0.47625109553337097,
      "pose_rmse_dx": 0.2375023066997528,
      "pose_rmse_dy": 0.18126007914543152,
      "pose_rmse_mean": 0.29833781719207764,
      "rmse_dtheta": 0.0523589588701725,
      "rmse_dx": 0.02717074379324913,
      "rmse_dy": 0.011149515397846699,
      "rmse_mean": 0.030226407572627068,
      "rotation_flip": 0.015635179355740547,
      "sparse_tokens": 27933.0,
      "step": 8546,
      "turn_loss": 0.27804335951805115,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.39709161865824194,
      "grad_norm": 0.6359668374061584,
      "learning_rate": 1.9446668923520014e-06,
      "loss": 0.0846,
      "mae_dtheta": 0.008552800863981247,
      "mae_dx": 0.0011782500660046935,
      "mae_dy": 0.001750025781802833,
      "pose_mae_dtheta": 0.062002528458833694,
      "pose_mae_dx": 0.01674197055399418,
      "pose_mae_dy": 0.022928372025489807,
      "pose_rmse_dtheta": 0.19549322128295898,
      "pose_rmse_dx": 0.05026606470346451,
      "pose_rmse_dy": 0.06163935363292694,
      "pose_rmse_mean": 0.10246621072292328,
      "rmse_dtheta": 0.021491089835762978,
      "rmse_dx": 0.003855148795992136,
      "rmse_dy": 0.004083902109414339,
      "rmse_mean": 0.009810047224164009,
      "rotation_flip": 0.002263467526063323,
      "sparse_tokens": 32057.0,
      "step": 8547,
      "turn_loss": 0.05971120670437813,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.3971380784240847,
      "grad_norm": 0.4625660181045532,
      "learning_rate": 1.943620358071623e-06,
      "loss": 0.1056,
      "mae_dtheta": 0.005391523241996765,
      "mae_dx": 0.001102299545891583,
      "mae_dy": 0.0009505893685854971,
      "pose_mae_dtheta": 0.03642129898071289,
      "pose_mae_dx": 0.011269847862422466,
      "pose_mae_dy": 0.013776508159935474,
      "pose_rmse_dtheta": 0.10052910447120667,
      "pose_rmse_dx": 0.02822190895676613,
      "pose_rmse_dy": 0.04296932741999626,
      "pose_rmse_mean": 0.057240113615989685,
      "rmse_dtheta": 0.015976404771208763,
      "rmse_dx": 0.003495042212307453,
      "rmse_dy": 0.0022279841359704733,
      "rmse_mean": 0.007233144249767065,
      "rotation_flip": 0.002665481995791197,
      "sparse_tokens": 32169.0,
      "step": 8548,
      "turn_loss": 0.04053102061152458,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64681.0,
      "epoch": 0.39718453818992755,
      "grad_norm": 0.5806921720504761,
      "learning_rate": 1.942574037525515e-06,
      "loss": 0.1232,
      "mae_dtheta": 0.007750918157398701,
      "mae_dx": 0.001257305033504963,
      "mae_dy": 0.0002172462991438806,
      "pose_mae_dtheta": 0.05526315048336983,
      "pose_mae_dx": 0.009564281441271305,
      "pose_mae_dy": 0.0029214154928922653,
      "pose_rmse_dtheta": 0.247579887509346,
      "pose_rmse_dx": 0.020800529047846794,
      "pose_rmse_dy": 0.005959418602287769,
      "pose_rmse_mean": 0.09144660830497742,
      "rmse_dtheta": 0.029148973524570465,
      "rmse_dx": 0.0034076476003974676,
      "rmse_dy": 0.00044284205068834126,
      "rmse_mean": 0.010999821126461029,
      "rotation_flip": 0.0014541929122060537,
      "sparse_tokens": 32281.0,
      "step": 8549,
      "turn_loss": 0.04945683851838112,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.3972309979557703,
      "grad_norm": 0.39265552163124084,
      "learning_rate": 1.9415279307868435e-06,
      "loss": 0.0816,
      "mae_dtheta": 0.009307333268225193,
      "mae_dx": 0.001478632795624435,
      "mae_dy": 0.0021349401213228703,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.39265552163124084,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.13388061523438,
      "model/head/act_norm_mean": 110.25087791982324,
      "model/head/act_norm_min": 67.55555725097656,
      "model/head/act_over_embed": 75.76543549148396,
      "model/head/grad_frac": 0.09183460474014282,
      "model/head/grad_norm": 0.036059364676475525,
      "model/head/grad_zero_frac": 0.00022240751422941685,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7106810290404041,
      "model/head/update_ratio": 0.0006141798221506178,
      "model/head/weight_delta": 9.78916072845459,
      "model/head/weight_delta_rel": 0.1717308759689331,
      "model/head/weight_norm": 58.71141052246094,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223586618900299,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42229538312241366,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42222657799720764,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29020534087338934,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09030120819807053,
      "model/modality_embedder.encoders.pose/grad_norm": 0.035457268357276917,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.498519549086758,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011449772864580154,
      "model/modality_embedder.encoders.pose/weight_delta": 3.119987964630127,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10193973034620285,
      "model/modality_embedder.encoders.pose/weight_norm": 30.967660903930664,
      "model/modality_embedder/grad_frac": 0.09030120819807053,
      "model/modality_embedder/grad_norm": 0.035457268357276917,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.498519549086758,
      "model/modality_embedder/update_ratio": 0.0011449772864580154,
      "model/modality_embedder/weight_delta": 3.119987964630127,
      "model/modality_embedder/weight_delta_rel": 0.10193973034620285,
      "model/modality_embedder/weight_norm": 30.967660903930664,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.46968078613281,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.620255130671797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.00442123413086,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.23206046211025,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.04770663008093834,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.01873227208852768,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0006704679108224809,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6438698768615723,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09634421020746231,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.939102172851562,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.19023895263672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.581574675324674,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.2711820602417,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.892688253211084,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05551464483141899,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.021798131987452507,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007330630323849618,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3524675369262695,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11613209545612335,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.735685348510742,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.04594421386719,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.39236612153279,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.36068058013916,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.137081087941915,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06526971608400345,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02562851458787918,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008346862741746008,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6263670921325684,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12176661938428879,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.704368591308594,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.76081085205078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.138675945967613,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.925308227539062,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.33716154850369,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06613000482320786,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.025966310873627663,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008676734287291765,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1099348068237305,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10628281533718109,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.92636489868164,
      "model/normalizer/grad_frac": 0.20048505067825317,
      "model/normalizer/grad_norm": 0.0787215605378151,
      "model/normalizer/grad_zero_frac": 0.0002162581222364679,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010013127466663718,
      "model/normalizer/weight_delta": 6.55613899230957,
      "model/normalizer/weight_delta_rel": 0.08443927764892578,
      "model/normalizer/weight_norm": 78.61835479736328,
      "pose_mae_dtheta": 0.06013448163866997,
      "pose_mae_dx": 0.021321993321180344,
      "pose_mae_dy": 0.026835160329937935,
      "pose_rmse_dtheta": 0.13228395581245422,
      "pose_rmse_dx": 0.054279252886772156,
      "pose_rmse_dy": 0.0595056526362896,
      "pose_rmse_mean": 0.08202295750379562,
      "rmse_dtheta": 0.01979934610426426,
      "rmse_dx": 0.0045574624091386795,
      "rmse_dy": 0.004711230285465717,
      "rmse_mean": 0.009689345955848694,
      "rotation_flip": 0.0036855037324130535,
      "sparse_tokens": 32073.0,
      "step": 8550,
      "turn_loss": 0.0731014534831047,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.3972774577216131,
      "grad_norm": 0.3570766746997833,
      "learning_rate": 1.9404820379287677e-06,
      "loss": 0.1002,
      "mae_dtheta": 0.04085735231637955,
      "mae_dx": 0.009465649724006653,
      "mae_dy": 0.012026084586977959,
      "pose_mae_dtheta": 0.3559945225715637,
      "pose_mae_dx": 0.05483104661107063,
      "pose_mae_dy": 0.14072437584400177,
      "pose_rmse_dtheta": 0.5665661692619324,
      "pose_rmse_dx": 0.12314838916063309,
      "pose_rmse_dy": 0.3179016709327698,
      "pose_rmse_mean": 0.3358721137046814,
      "rmse_dtheta": 0.054222483187913895,
      "rmse_dx": 0.020257048308849335,
      "rmse_dy": 0.021691983565688133,
      "rmse_mean": 0.03205717355012894,
      "rotation_flip": 0.011538461782038212,
      "sparse_tokens": 4294.0,
      "step": 8551,
      "turn_loss": 0.3581995964050293,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3973239174874559,
      "grad_norm": 0.4785781800746918,
      "learning_rate": 1.9394363590244232e-06,
      "loss": 0.1134,
      "mae_dtheta": 0.011739721521735191,
      "mae_dx": 0.002147737191990018,
      "mae_dy": 0.0027122662868350744,
      "pose_mae_dtheta": 0.07906268537044525,
      "pose_mae_dx": 0.02267206832766533,
      "pose_mae_dy": 0.02710220217704773,
      "pose_rmse_dtheta": 0.2148820012807846,
      "pose_rmse_dx": 0.06114989519119263,
      "pose_rmse_dy": 0.06247943639755249,
      "pose_rmse_mean": 0.11283712089061737,
      "rmse_dtheta": 0.026858104392886162,
      "rmse_dx": 0.007268038112670183,
      "rmse_dy": 0.005816638935357332,
      "rmse_mean": 0.013314261101186275,
      "rotation_flip": 0.012412723153829575,
      "sparse_tokens": 32105.0,
      "step": 8552,
      "turn_loss": 0.11318814754486084,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.39737037725329866,
      "grad_norm": 0.6446717977523804,
      "learning_rate": 1.9383908941469383e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.03520498797297478,
      "mae_dx": 0.011248871684074402,
      "mae_dy": 0.0023734199348837137,
      "pose_mae_dtheta": 0.2898537516593933,
      "pose_mae_dx": 0.07477829605340958,
      "pose_mae_dy": 0.02324674092233181,
      "pose_rmse_dtheta": 0.5060837864875793,
      "pose_rmse_dx": 0.20208901166915894,
      "pose_rmse_dy": 0.05644136667251587,
      "pose_rmse_mean": 0.2548713982105255,
      "rmse_dtheta": 0.053501177579164505,
      "rmse_dx": 0.023972615599632263,
      "rmse_dy": 0.004958133678883314,
      "rmse_mean": 0.027477307245135307,
      "rotation_flip": 0.006542055867612362,
      "sparse_tokens": 18059.0,
      "step": 8553,
      "turn_loss": 0.23260247707366943,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.39741683701914143,
      "grad_norm": 0.4522588849067688,
      "learning_rate": 1.93734564336942e-06,
      "loss": 0.129,
      "mae_dtheta": 0.03314816579222679,
      "mae_dx": 0.013736769556999207,
      "mae_dy": 0.0061645423993468285,
      "pose_mae_dtheta": 0.24531708657741547,
      "pose_mae_dx": 0.09752073138952255,
      "pose_mae_dy": 0.07731425017118454,
      "pose_rmse_dtheta": 0.4460645020008087,
      "pose_rmse_dx": 0.19869066774845123,
      "pose_rmse_dy": 0.16141530871391296,
      "pose_rmse_mean": 0.2687234878540039,
      "rmse_dtheta": 0.05133773386478424,
      "rmse_dx": 0.027018358930945396,
      "rmse_dy": 0.010897625237703323,
      "rmse_mean": 0.029751241207122803,
      "rotation_flip": 0.017162472009658813,
      "sparse_tokens": 14639.0,
      "step": 8554,
      "turn_loss": 0.25295189023017883,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.3974632967849842,
      "grad_norm": 0.5104705095291138,
      "learning_rate": 1.9363006067649663e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.01951335184276104,
      "mae_dx": 0.0053949784487485886,
      "mae_dy": 0.0037451409734785557,
      "pose_mae_dtheta": 0.14443901181221008,
      "pose_mae_dx": 0.05898043140769005,
      "pose_mae_dy": 0.055933333933353424,
      "pose_rmse_dtheta": 0.3339029848575592,
      "pose_rmse_dx": 0.15793882310390472,
      "pose_rmse_dy": 0.13760535418987274,
      "pose_rmse_mean": 0.20981572568416595,
      "rmse_dtheta": 0.038796499371528625,
      "rmse_dx": 0.015743371099233627,
      "rmse_dy": 0.008267773315310478,
      "rmse_mean": 0.02093588188290596,
      "rotation_flip": 0.03064066916704178,
      "sparse_tokens": 7798.0,
      "step": 8555,
      "turn_loss": 0.1343512088060379,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.397509756550827,
      "grad_norm": 0.377615749835968,
      "learning_rate": 1.9352557844066538e-06,
      "loss": 0.0948,
      "mae_dtheta": 0.009015842340886593,
      "mae_dx": 0.0017196531407535076,
      "mae_dy": 0.0017002152744680643,
      "pose_mae_dtheta": 0.05482540279626846,
      "pose_mae_dx": 0.01683633215725422,
      "pose_mae_dy": 0.021182458847761154,
      "pose_rmse_dtheta": 0.12869903445243835,
      "pose_rmse_dx": 0.03913901001214981,
      "pose_rmse_dy": 0.0431576743721962,
      "pose_rmse_mean": 0.07033190131187439,
      "rmse_dtheta": 0.020156754180788994,
      "rmse_dx": 0.005787000525742769,
      "rmse_dy": 0.0030828071758151054,
      "rmse_mean": 0.009675520472228527,
      "rotation_flip": 0.0023210830986499786,
      "sparse_tokens": 32105.0,
      "step": 8556,
      "turn_loss": 0.07083091139793396,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.39755621631666976,
      "grad_norm": 0.39247843623161316,
      "learning_rate": 1.9342111763675512e-06,
      "loss": 0.1199,
      "mae_dtheta": 0.007044489029794931,
      "mae_dx": 0.0011906410800293088,
      "mae_dy": 0.0019505209056660533,
      "pose_mae_dtheta": 0.04166475683450699,
      "pose_mae_dx": 0.015384947881102562,
      "pose_mae_dy": 0.023313628509640694,
      "pose_rmse_dtheta": 0.0815463587641716,
      "pose_rmse_dx": 0.04088746756315231,
      "pose_rmse_dy": 0.05470551922917366,
      "pose_rmse_mean": 0.05904644727706909,
      "rmse_dtheta": 0.014345460571348667,
      "rmse_dx": 0.0036609661765396595,
      "rmse_dy": 0.004391665570437908,
      "rmse_mean": 0.007466030772775412,
      "rotation_flip": 0.004860267508774996,
      "sparse_tokens": 32057.0,
      "step": 8557,
      "turn_loss": 0.06375390291213989,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.39760267608251254,
      "grad_norm": 0.46716931462287903,
      "learning_rate": 1.9331667827207047e-06,
      "loss": 0.0823,
      "mae_dtheta": 0.006780849304050207,
      "mae_dx": 0.0013030326226726174,
      "mae_dy": 0.001099687535315752,
      "pose_mae_dtheta": 0.05003967881202698,
      "pose_mae_dx": 0.013800380751490593,
      "pose_mae_dy": 0.017074307426810265,
      "pose_rmse_dtheta": 0.13824856281280518,
      "pose_rmse_dx": 0.03853343799710274,
      "pose_rmse_dy": 0.04724809154868126,
      "pose_rmse_mean": 0.07467669993638992,
      "rmse_dtheta": 0.01748513989150524,
      "rmse_dx": 0.0043715438805520535,
      "rmse_dy": 0.0029929066076874733,
      "rmse_mean": 0.008283196948468685,
      "rotation_flip": 0.0023126734886318445,
      "sparse_tokens": 32137.0,
      "step": 8558,
      "turn_loss": 0.04708585888147354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3976491358483553,
      "grad_norm": 0.4334891140460968,
      "learning_rate": 1.9321226035391526e-06,
      "loss": 0.074,
      "mae_dtheta": 0.008767113089561462,
      "mae_dx": 0.0012606455711647868,
      "mae_dy": 0.0017710673855617642,
      "pose_mae_dtheta": 0.057588424533605576,
      "pose_mae_dx": 0.015507674776017666,
      "pose_mae_dy": 0.01803152821958065,
      "pose_rmse_dtheta": 0.21545608341693878,
      "pose_rmse_dx": 0.0502438098192215,
      "pose_rmse_dy": 0.0471896268427372,
      "pose_rmse_mean": 0.10429650545120239,
      "rmse_dtheta": 0.024966320022940636,
      "rmse_dx": 0.0037979360204190016,
      "rmse_dy": 0.005005989223718643,
      "rmse_mean": 0.0112567488104105,
      "rotation_flip": 0.0037914691492915154,
      "sparse_tokens": 32089.0,
      "step": 8559,
      "turn_loss": 0.06684677302837372,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.3976955956141981,
      "grad_norm": 0.5887576341629028,
      "learning_rate": 1.9310786388959125e-06,
      "loss": 0.1698,
      "mae_dtheta": 0.034577637910842896,
      "mae_dx": 0.010838346555829048,
      "mae_dy": 0.006103597115725279,
      "pose_mae_dtheta": 0.30178114771842957,
      "pose_mae_dx": 0.07768943160772324,
      "pose_mae_dy": 0.09681679308414459,
      "pose_rmse_dtheta": 0.5170971155166626,
      "pose_rmse_dx": 0.17368456721305847,
      "pose_rmse_dy": 0.2053530216217041,
      "pose_rmse_mean": 0.2987115979194641,
      "rmse_dtheta": 0.052174922078847885,
      "rmse_dx": 0.023335859179496765,
      "rmse_dy": 0.010200467891991138,
      "rmse_mean": 0.028570419177412987,
      "rotation_flip": 0.01701093651354313,
      "sparse_tokens": 15882.0,
      "step": 8560,
      "turn_loss": 0.3060656785964966,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.39774205538004087,
      "grad_norm": 0.4598599374294281,
      "learning_rate": 1.9300348888639915e-06,
      "loss": 0.0995,
      "mae_dtheta": 0.009838728234171867,
      "mae_dx": 0.0009762784466147423,
      "mae_dy": 0.0015639786142855883,
      "pose_mae_dtheta": 0.06455229967832565,
      "pose_mae_dx": 0.013275113888084888,
      "pose_mae_dy": 0.018870068714022636,
      "pose_rmse_dtheta": 0.2171875238418579,
      "pose_rmse_dx": 0.031128723174333572,
      "pose_rmse_dy": 0.0441695898771286,
      "pose_rmse_mean": 0.09749528020620346,
      "rmse_dtheta": 0.02415497601032257,
      "rmse_dx": 0.003044834826141596,
      "rmse_dy": 0.0031319670379161835,
      "rmse_mean": 0.010110592469573021,
      "rotation_flip": 0.006666666828095913,
      "sparse_tokens": 32105.0,
      "step": 8561,
      "turn_loss": 0.0627608597278595,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.39778851514588365,
      "grad_norm": 0.4272231161594391,
      "learning_rate": 1.9289913535163766e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.009960063733160496,
      "mae_dx": 0.0021289747674018145,
      "mae_dy": 0.0020102167036384344,
      "pose_mae_dtheta": 0.0657825767993927,
      "pose_mae_dx": 0.019276374951004982,
      "pose_mae_dy": 0.01965639367699623,
      "pose_rmse_dtheta": 0.1925378292798996,
      "pose_rmse_dx": 0.062140971422195435,
      "pose_rmse_dy": 0.04700527712702751,
      "pose_rmse_mean": 0.10056135058403015,
      "rmse_dtheta": 0.025391334667801857,
      "rmse_dx": 0.007355497684329748,
      "rmse_dy": 0.00681348005309701,
      "rmse_mean": 0.013186771422624588,
      "rotation_flip": 0.003849443979561329,
      "sparse_tokens": 32153.0,
      "step": 8562,
      "turn_loss": 0.08807066828012466,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4886.0,
      "epoch": 0.3978349749117264,
      "grad_norm": 0.6735944151878357,
      "learning_rate": 1.927948032926047e-06,
      "loss": 0.1397,
      "mae_dtheta": 0.02261814847588539,
      "mae_dx": 0.008443203754723072,
      "mae_dy": 0.0024835483636707067,
      "pose_mae_dtheta": 0.19644686579704285,
      "pose_mae_dx": 0.07605625689029694,
      "pose_mae_dy": 0.029138069599866867,
      "pose_rmse_dtheta": 0.3265233337879181,
      "pose_rmse_dx": 0.1663370281457901,
      "pose_rmse_dy": 0.07569549232721329,
      "pose_rmse_mean": 0.18951863050460815,
      "rmse_dtheta": 0.03635742515325546,
      "rmse_dx": 0.01729929819703102,
      "rmse_dy": 0.005251223221421242,
      "rmse_mean": 0.019635982811450958,
      "rotation_flip": 0.004878048785030842,
      "sparse_tokens": 3688.0,
      "step": 8563,
      "turn_loss": 0.18240118026733398,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 1340.0,
      "epoch": 0.3978814346775692,
      "grad_norm": 0.5369787216186523,
      "learning_rate": 1.9269049271659586e-06,
      "loss": 0.1364,
      "mae_dtheta": 0.04477645084261894,
      "mae_dx": 0.019394338130950928,
      "mae_dy": 0.008055325597524643,
      "pose_mae_dtheta": 0.3265106976032257,
      "pose_mae_dx": 0.13227073848247528,
      "pose_mae_dy": 0.14402084052562714,
      "pose_rmse_dtheta": 0.4959341585636139,
      "pose_rmse_dx": 0.22993336617946625,
      "pose_rmse_dy": 0.21670201420783997,
      "pose_rmse_mean": 0.3141898512840271,
      "rmse_dtheta": 0.0567433200776577,
      "rmse_dx": 0.03266814723610878,
      "rmse_dy": 0.009741656482219696,
      "rmse_mean": 0.03305104374885559,
      "rotation_flip": 0.0,
      "sparse_tokens": 1163.0,
      "step": 8564,
      "turn_loss": 0.4266050457954407,
      "turns": 4.0,
      "turns_per_sample": 4.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.397927894443412,
      "grad_norm": 0.5683877468109131,
      "learning_rate": 1.925862036309059e-06,
      "loss": 0.118,
      "mae_dtheta": 0.02853468619287014,
      "mae_dx": 0.016813278198242188,
      "mae_dy": 0.003549173939973116,
      "pose_mae_dtheta": 0.20636117458343506,
      "pose_mae_dx": 0.13944922387599945,
      "pose_mae_dy": 0.08399427682161331,
      "pose_rmse_dtheta": 0.32772451639175415,
      "pose_rmse_dx": 0.2629566192626953,
      "pose_rmse_dy": 0.16549977660179138,
      "pose_rmse_mean": 0.25206029415130615,
      "rmse_dtheta": 0.040860310196876526,
      "rmse_dx": 0.02968393824994564,
      "rmse_dy": 0.005962937604635954,
      "rmse_mean": 0.025502396747469902,
      "rotation_flip": 0.017793593928217888,
      "sparse_tokens": 4785.0,
      "step": 8565,
      "turn_loss": 0.23406875133514404,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.3979743542092548,
      "grad_norm": 0.4675472676753998,
      "learning_rate": 1.924819360428276e-06,
      "loss": 0.1457,
      "mae_dtheta": 0.03260151296854019,
      "mae_dx": 0.012021103873848915,
      "mae_dy": 0.005726669915020466,
      "pose_mae_dtheta": 0.250671923160553,
      "pose_mae_dx": 0.08944258093833923,
      "pose_mae_dy": 0.06243486329913139,
      "pose_rmse_dtheta": 0.4642370045185089,
      "pose_rmse_dx": 0.19193899631500244,
      "pose_rmse_dy": 0.13495805859565735,
      "pose_rmse_mean": 0.2637113332748413,
      "rmse_dtheta": 0.051551755517721176,
      "rmse_dx": 0.023474151268601418,
      "rmse_dy": 0.010637423023581505,
      "rmse_mean": 0.028554445132613182,
      "rotation_flip": 0.013005780056118965,
      "sparse_tokens": 12180.0,
      "step": 8566,
      "turn_loss": 0.328407347202301,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.3980208139750976,
      "grad_norm": 1.0019375085830688,
      "learning_rate": 1.9237768995965258e-06,
      "loss": 0.2782,
      "mae_dtheta": 0.03601691499352455,
      "mae_dx": 0.014639098197221756,
      "mae_dy": 0.00646639009937644,
      "pose_mae_dtheta": 0.3022206723690033,
      "pose_mae_dx": 0.12078153342008591,
      "pose_mae_dy": 0.079581119120121,
      "pose_rmse_dtheta": 0.5220903158187866,
      "pose_rmse_dx": 0.22738736867904663,
      "pose_rmse_dy": 0.19476185739040375,
      "pose_rmse_mean": 0.31474652886390686,
      "rmse_dtheta": 0.05514957383275032,
      "rmse_dx": 0.02634488418698311,
      "rmse_dy": 0.014214622788131237,
      "rmse_mean": 0.03190302848815918,
      "rotation_flip": 0.015625,
      "sparse_tokens": 9660.0,
      "step": 8567,
      "turn_loss": 0.3184230327606201,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.39806727374094036,
      "grad_norm": 0.43017148971557617,
      "learning_rate": 1.9227346538867093e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.011229811236262321,
      "mae_dx": 0.0016580448718741536,
      "mae_dy": 0.0024049319326877594,
      "pose_mae_dtheta": 0.07287213951349258,
      "pose_mae_dx": 0.02354441210627556,
      "pose_mae_dy": 0.026674073189496994,
      "pose_rmse_dtheta": 0.18893997371196747,
      "pose_rmse_dx": 0.05304930359125137,
      "pose_rmse_dy": 0.05700857937335968,
      "pose_rmse_mean": 0.09966596215963364,
      "rmse_dtheta": 0.024846473708748817,
      "rmse_dx": 0.004702939186245203,
      "rmse_dy": 0.004696637857705355,
      "rmse_mean": 0.011415350250899792,
      "rotation_flip": 0.0046964106149971485,
      "sparse_tokens": 32121.0,
      "step": 8568,
      "turn_loss": 0.08782529085874557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.39811373350678314,
      "grad_norm": 0.6746214628219604,
      "learning_rate": 1.9216926233717087e-06,
      "loss": 0.1188,
      "mae_dtheta": 0.03857744112610817,
      "mae_dx": 0.016566531732678413,
      "mae_dy": 0.010300456546247005,
      "pose_mae_dtheta": 0.29521432518959045,
      "pose_mae_dx": 0.16402386128902435,
      "pose_mae_dy": 0.1783270239830017,
      "pose_rmse_dtheta": 0.44739052653312683,
      "pose_rmse_dx": 0.30072328448295593,
      "pose_rmse_dy": 0.29503700137138367,
      "pose_rmse_mean": 0.34771692752838135,
      "rmse_dtheta": 0.05345472693443298,
      "rmse_dx": 0.03029554896056652,
      "rmse_dy": 0.015481416136026382,
      "rmse_mean": 0.03307723253965378,
      "rotation_flip": 0.015555555932223797,
      "sparse_tokens": 8186.0,
      "step": 8569,
      "turn_loss": 0.3473053574562073,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3981601932726259,
      "grad_norm": 0.666687548160553,
      "learning_rate": 1.9206508081243973e-06,
      "loss": 0.0894,
      "mae_dtheta": 0.008348309434950352,
      "mae_dx": 0.001432435354217887,
      "mae_dy": 0.001979852095246315,
      "pose_mae_dtheta": 0.05957205593585968,
      "pose_mae_dx": 0.01591951586306095,
      "pose_mae_dy": 0.01872125267982483,
      "pose_rmse_dtheta": 0.201597660779953,
      "pose_rmse_dx": 0.046904057264328,
      "pose_rmse_dy": 0.05275335535407066,
      "pose_rmse_mean": 0.10041835904121399,
      "rmse_dtheta": 0.024619245901703835,
      "rmse_dx": 0.004684413783252239,
      "rmse_dy": 0.006118159741163254,
      "rmse_mean": 0.011807273142039776,
      "rotation_flip": 0.0015143866185098886,
      "sparse_tokens": 32089.0,
      "step": 8570,
      "turn_loss": 0.07777891308069229,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.3982066530384687,
      "grad_norm": 0.8012836575508118,
      "learning_rate": 1.9196092082176254e-06,
      "loss": 0.2079,
      "mae_dtheta": 0.005743927787989378,
      "mae_dx": 0.001186710549518466,
      "mae_dy": 0.0002535756502766162,
      "pose_mae_dtheta": 0.03940458595752716,
      "pose_mae_dx": 0.009043951518833637,
      "pose_mae_dy": 0.003878750605508685,
      "pose_rmse_dtheta": 0.180180624127388,
      "pose_rmse_dx": 0.021886108443140984,
      "pose_rmse_dy": 0.019174842163920403,
      "pose_rmse_mean": 0.0737471953034401,
      "rmse_dtheta": 0.0237417034804821,
      "rmse_dx": 0.0032317538280040026,
      "rmse_dy": 0.0006959557649679482,
      "rmse_mean": 0.009223137982189655,
      "rotation_flip": 0.0019543974194675684,
      "sparse_tokens": 32201.0,
      "step": 8571,
      "turn_loss": 0.04752160608768463,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.39825311280431147,
      "grad_norm": 0.5663304924964905,
      "learning_rate": 1.9185678237242373e-06,
      "loss": 0.1675,
      "mae_dtheta": 0.008977511897683144,
      "mae_dx": 0.0015565358335152268,
      "mae_dy": 0.0023875930346548557,
      "pose_mae_dtheta": 0.05727009475231171,
      "pose_mae_dx": 0.018431365489959717,
      "pose_mae_dy": 0.024198375642299652,
      "pose_rmse_dtheta": 0.15915720164775848,
      "pose_rmse_dx": 0.045587461441755295,
      "pose_rmse_dy": 0.05402689427137375,
      "pose_rmse_mean": 0.08625718951225281,
      "rmse_dtheta": 0.01967698149383068,
      "rmse_dx": 0.0044087814167141914,
      "rmse_dy": 0.005392968188971281,
      "rmse_mean": 0.009826244786381721,
      "rotation_flip": 0.007521773688495159,
      "sparse_tokens": 32073.0,
      "step": 8572,
      "turn_loss": 0.0818367600440979,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.39829957257015425,
      "grad_norm": 0.4414280354976654,
      "learning_rate": 1.917526654717053e-06,
      "loss": 0.1149,
      "mae_dtheta": 0.011064085178077221,
      "mae_dx": 0.0014321693452075124,
      "mae_dy": 0.002848140662536025,
      "pose_mae_dtheta": 0.06907625496387482,
      "pose_mae_dx": 0.023191828280687332,
      "pose_mae_dy": 0.030154932290315628,
      "pose_rmse_dtheta": 0.1733132302761078,
      "pose_rmse_dx": 0.06539293378591537,
      "pose_rmse_dy": 0.07780478894710541,
      "pose_rmse_mean": 0.10550366342067719,
      "rmse_dtheta": 0.024671683087944984,
      "rmse_dx": 0.003965304233133793,
      "rmse_dy": 0.0063834404572844505,
      "rmse_mean": 0.011673476547002792,
      "rotation_flip": 0.003612716682255268,
      "sparse_tokens": 32073.0,
      "step": 8573,
      "turn_loss": 0.09295132011175156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.398346032335997,
      "grad_norm": 0.5214724540710449,
      "learning_rate": 1.9164857012688837e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.009106389246881008,
      "mae_dx": 0.0013563131215050817,
      "mae_dy": 0.0015594407450407743,
      "pose_mae_dtheta": 0.05574765428900719,
      "pose_mae_dx": 0.013830446638166904,
      "pose_mae_dy": 0.01692374423146248,
      "pose_rmse_dtheta": 0.172537162899971,
      "pose_rmse_dx": 0.03325854614377022,
      "pose_rmse_dy": 0.039908379316329956,
      "pose_rmse_mean": 0.08190136402845383,
      "rmse_dtheta": 0.023962749168276787,
      "rmse_dx": 0.004063053987920284,
      "rmse_dy": 0.0033063848968595266,
      "rmse_mean": 0.010444062761962414,
      "rotation_flip": 0.003097173757851124,
      "sparse_tokens": 32169.0,
      "step": 8574,
      "turn_loss": 0.06905367225408554,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.3983924921018398,
      "grad_norm": 0.40111687779426575,
      "learning_rate": 1.915444963452527e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.007365008350461721,
      "mae_dx": 0.0015992383705452085,
      "mae_dy": 0.001196052529849112,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.40111684799194336,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.6068572998047,
      "model/head/act_norm_mean": 115.94820273042929,
      "model/head/act_norm_min": 77.57664489746094,
      "model/head/act_over_embed": 79.68069044052768,
      "model/head/grad_frac": 0.0856759250164032,
      "model/head/grad_norm": 0.03436605632305145,
      "model/head/grad_zero_frac": 0.0001906803372548893,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6949623184974747,
      "model/head/update_ratio": 0.0005853305337950587,
      "model/head/weight_delta": 9.79311752319336,
      "model/head/weight_delta_rel": 0.17180028557777405,
      "model/head/weight_norm": 58.712223052978516,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42236095666885376,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4222895515410237,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4222290813922882,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.290201333356062,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12671756744384766,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05082855001091957,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5516727178423236,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016413388075307012,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1187283992767334,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10189858078956604,
      "model/modality_embedder.encoders.pose/weight_norm": 30.967737197875977,
      "model/modality_embedder/grad_frac": 0.12671756744384766,
      "model/modality_embedder/grad_norm": 0.05082855001091957,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5516727178423236,
      "model/modality_embedder/update_ratio": 0.0016413388075307012,
      "model/modality_embedder/weight_delta": 3.1187283992767334,
      "model/modality_embedder/weight_delta_rel": 0.10189858078956604,
      "model/modality_embedder/weight_norm": 30.967737197875977,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 95.32164764404297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.28412598204265,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.100862503051758,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.688278726429136,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.050678182393312454,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.020327873528003693,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007275674142874777,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6459643840789795,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0964205414056778,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.939504623413086,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 97.25591278076172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.3104006333173,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.302888870239258,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.39354427491974,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05013825744390488,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02011130005121231,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0006763202254660428,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3551502227783203,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11622502654790878,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.736358642578125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 99.22388458251953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.13747594997595,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.435189247131348,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.649127537876176,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.051527563482522964,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.020668573677539825,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0006731359753757715,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.62917423248291,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12186087667942047,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.70490074157715,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 99.9967269897461,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.82270121853455,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.165911674499512,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.807230119757186,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05187108740210533,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.020806366577744484,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006952370167709887,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1127405166625977,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1063786968588829,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.927011489868164,
      "model/normalizer/grad_frac": 0.20377956330776215,
      "model/normalizer/grad_norm": 0.08173941820859909,
      "model/normalizer/grad_zero_frac": 0.0002493468055035919,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010396884754300117,
      "model/normalizer/weight_delta": 6.561534881591797,
      "model/normalizer/weight_delta_rel": 0.08450876921415329,
      "model/normalizer/weight_norm": 78.619140625,
      "pose_mae_dtheta": 0.05124024674296379,
      "pose_mae_dx": 0.015524059534072876,
      "pose_mae_dy": 0.013578692451119423,
      "pose_rmse_dtheta": 0.15672844648361206,
      "pose_rmse_dx": 0.037409793585538864,
      "pose_rmse_dy": 0.03614090010523796,
      "pose_rmse_mean": 0.0767597183585167,
      "rmse_dtheta": 0.020005246624350548,
      "rmse_dx": 0.004313943441957235,
      "rmse_dy": 0.0028586473781615496,
      "rmse_mean": 0.009059280157089233,
      "rotation_flip": 0.004890895448625088,
      "sparse_tokens": 32249.0,
      "step": 8575,
      "turn_loss": 0.05491529405117035,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.3984389518676826,
      "grad_norm": 0.5512322783470154,
      "learning_rate": 1.9144044413407577e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.008944299072027206,
      "mae_dx": 0.0012785332510247827,
      "mae_dy": 0.00022440544853452593,
      "pose_mae_dtheta": 0.06677497923374176,
      "pose_mae_dx": 0.009875025600194931,
      "pose_mae_dy": 0.0031986574176698923,
      "pose_rmse_dtheta": 0.28344273567199707,
      "pose_rmse_dx": 0.02170071378350258,
      "pose_rmse_dy": 0.007776721380650997,
      "pose_rmse_mean": 0.10430672019720078,
      "rmse_dtheta": 0.03195894509553909,
      "rmse_dx": 0.0034942852798849344,
      "rmse_dy": 0.0005073159700259566,
      "rmse_mean": 0.011986849829554558,
      "rotation_flip": 0.0017615972319617867,
      "sparse_tokens": 32217.0,
      "step": 8576,
      "turn_loss": 0.04103570058941841,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.39848541163352535,
      "grad_norm": 0.7699840664863586,
      "learning_rate": 1.913364135006343e-06,
      "loss": 0.1696,
      "mae_dtheta": 0.03449627012014389,
      "mae_dx": 0.014415533281862736,
      "mae_dy": 0.005000562872737646,
      "pose_mae_dtheta": 0.25971680879592896,
      "pose_mae_dx": 0.11969943344593048,
      "pose_mae_dy": 0.07261885702610016,
      "pose_rmse_dtheta": 0.4648376405239105,
      "pose_rmse_dx": 0.2576383948326111,
      "pose_rmse_dy": 0.1609935164451599,
      "pose_rmse_mean": 0.29448986053466797,
      "rmse_dtheta": 0.05208110064268112,
      "rmse_dx": 0.028220834210515022,
      "rmse_dy": 0.00905134342610836,
      "rmse_mean": 0.0297844260931015,
      "rotation_flip": 0.012609117664396763,
      "sparse_tokens": 17481.0,
      "step": 8577,
      "turn_loss": 0.2739839255809784,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 27903.0,
      "epoch": 0.39853187139936813,
      "grad_norm": 0.4988553822040558,
      "learning_rate": 1.9123240445220297e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.0276759285479784,
      "mae_dx": 0.011871105059981346,
      "mae_dy": 0.0028317670803517103,
      "pose_mae_dtheta": 0.2042357176542282,
      "pose_mae_dx": 0.08730284869670868,
      "pose_mae_dy": 0.032813627272844315,
      "pose_rmse_dtheta": 0.39692720770835876,
      "pose_rmse_dx": 0.23394690454006195,
      "pose_rmse_dy": 0.08497978746891022,
      "pose_rmse_mean": 0.23861795663833618,
      "rmse_dtheta": 0.046517129987478256,
      "rmse_dx": 0.025775492191314697,
      "rmse_dy": 0.0056122541427612305,
      "rmse_mean": 0.025968294590711594,
      "rotation_flip": 0.011208967305719852,
      "sparse_tokens": 20969.0,
      "step": 8578,
      "turn_loss": 0.21608437597751617,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.3985783311652109,
      "grad_norm": 0.6295214891433716,
      "learning_rate": 1.9112841699605534e-06,
      "loss": 0.1017,
      "mae_dtheta": 0.004524982068687677,
      "mae_dx": 0.0018567366059869528,
      "mae_dy": 0.00025420577730983496,
      "pose_mae_dtheta": 0.03641756251454353,
      "pose_mae_dx": 0.01448704395443201,
      "pose_mae_dy": 0.003963429946452379,
      "pose_rmse_dtheta": 0.14793124794960022,
      "pose_rmse_dx": 0.04095790535211563,
      "pose_rmse_dy": 0.009019200690090656,
      "pose_rmse_mean": 0.06596945226192474,
      "rmse_dtheta": 0.01746959425508976,
      "rmse_dx": 0.005916655529290438,
      "rmse_dy": 0.0005166943883523345,
      "rmse_mean": 0.007967648096382618,
      "rotation_flip": 0.0027624310459941626,
      "sparse_tokens": 32153.0,
      "step": 8579,
      "turn_loss": 0.040226928889751434,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3986247909310537,
      "grad_norm": 0.634574830532074,
      "learning_rate": 1.9102445113946345e-06,
      "loss": 0.1437,
      "mae_dtheta": 0.012202654033899307,
      "mae_dx": 0.0025115138851106167,
      "mae_dy": 0.00274389679543674,
      "pose_mae_dtheta": 0.089551642537117,
      "pose_mae_dx": 0.02559519372880459,
      "pose_mae_dy": 0.036192186176776886,
      "pose_rmse_dtheta": 0.21070891618728638,
      "pose_rmse_dx": 0.0592380128800869,
      "pose_rmse_dy": 0.0811968445777893,
      "pose_rmse_mean": 0.11704792827367783,
      "rmse_dtheta": 0.025593876838684082,
      "rmse_dx": 0.008325830101966858,
      "rmse_dy": 0.006566998083144426,
      "rmse_mean": 0.013495568186044693,
      "rotation_flip": 0.004158790223300457,
      "sparse_tokens": 32121.0,
      "step": 8580,
      "turn_loss": 0.10625716298818588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.39867125069689646,
      "grad_norm": 0.4834210276603699,
      "learning_rate": 1.9092050688969736e-06,
      "loss": 0.0949,
      "mae_dtheta": 0.008123061619699001,
      "mae_dx": 0.0011467766016721725,
      "mae_dy": 0.0013565339613705873,
      "pose_mae_dtheta": 0.054436128586530685,
      "pose_mae_dx": 0.014124446548521519,
      "pose_mae_dy": 0.01637156866490841,
      "pose_rmse_dtheta": 0.17300787568092346,
      "pose_rmse_dx": 0.03935709223151207,
      "pose_rmse_dy": 0.04328882694244385,
      "pose_rmse_mean": 0.08521793782711029,
      "rmse_dtheta": 0.021700803190469742,
      "rmse_dx": 0.003351439954712987,
      "rmse_dy": 0.0034272337798029184,
      "rmse_mean": 0.009493159130215645,
      "rotation_flip": 0.004087889567017555,
      "sparse_tokens": 32057.0,
      "step": 8581,
      "turn_loss": 0.059525687247514725,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.3987177104627393,
      "grad_norm": 0.4117169976234436,
      "learning_rate": 1.9081658425402628e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.030849508941173553,
      "mae_dx": 0.010501619428396225,
      "mae_dy": 0.0039024879224598408,
      "pose_mae_dtheta": 0.23463189601898193,
      "pose_mae_dx": 0.07569940388202667,
      "pose_mae_dy": 0.0741514265537262,
      "pose_rmse_dtheta": 0.44860580563545227,
      "pose_rmse_dx": 0.16887027025222778,
      "pose_rmse_dy": 0.1672198325395584,
      "pose_rmse_mean": 0.26156532764434814,
      "rmse_dtheta": 0.04781589284539223,
      "rmse_dx": 0.022388122975826263,
      "rmse_dy": 0.007147098891437054,
      "rmse_mean": 0.025783706456422806,
      "rotation_flip": 0.013400334864854813,
      "sparse_tokens": 10508.0,
      "step": 8582,
      "turn_loss": 0.23315735161304474,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.39876417022858207,
      "grad_norm": 0.6752474308013916,
      "learning_rate": 1.9071268323971725e-06,
      "loss": 0.1455,
      "mae_dtheta": 0.029580125585198402,
      "mae_dx": 0.011635538190603256,
      "mae_dy": 0.008542101830244064,
      "pose_mae_dtheta": 0.21091866493225098,
      "pose_mae_dx": 0.10165588557720184,
      "pose_mae_dy": 0.09607166796922684,
      "pose_rmse_dtheta": 0.31713658571243286,
      "pose_rmse_dx": 0.18922410905361176,
      "pose_rmse_dy": 0.20475025475025177,
      "pose_rmse_mean": 0.23703698813915253,
      "rmse_dtheta": 0.042684584856033325,
      "rmse_dx": 0.0221193116158247,
      "rmse_dy": 0.017031559720635414,
      "rmse_mean": 0.027278486639261246,
      "rotation_flip": 0.017591340467333794,
      "sparse_tokens": 13098.0,
      "step": 8583,
      "turn_loss": 0.32803037762641907,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.39881062999442485,
      "grad_norm": 0.48565128445625305,
      "learning_rate": 1.9060880385403645e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.039115939289331436,
      "mae_dx": 0.010872451588511467,
      "mae_dy": 0.0023454513866454363,
      "pose_mae_dtheta": 0.3700791001319885,
      "pose_mae_dx": 0.09345035254955292,
      "pose_mae_dy": 0.02126435749232769,
      "pose_rmse_dtheta": 0.6160668134689331,
      "pose_rmse_dx": 0.16346395015716553,
      "pose_rmse_dy": 0.04736727103590965,
      "pose_rmse_mean": 0.27563267946243286,
      "rmse_dtheta": 0.05902259796857834,
      "rmse_dx": 0.019093457609415054,
      "rmse_dy": 0.00456495163962245,
      "rmse_mean": 0.027560336515307426,
      "rotation_flip": 0.0220994483679533,
      "sparse_tokens": 3101.0,
      "step": 8584,
      "turn_loss": 0.27756616473197937,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.3988570897602676,
      "grad_norm": 0.3660014271736145,
      "learning_rate": 1.905049461042479e-06,
      "loss": 0.094,
      "mae_dtheta": 0.03292220085859299,
      "mae_dx": 0.010973303578794003,
      "mae_dy": 0.006310198921710253,
      "pose_mae_dtheta": 0.22844921052455902,
      "pose_mae_dx": 0.061875082552433014,
      "pose_mae_dy": 0.07448729872703552,
      "pose_rmse_dtheta": 0.41466739773750305,
      "pose_rmse_dx": 0.1381913274526596,
      "pose_rmse_dy": 0.1629861444234848,
      "pose_rmse_mean": 0.23861496150493622,
      "rmse_dtheta": 0.050515055656433105,
      "rmse_dx": 0.022592810913920403,
      "rmse_dy": 0.013643689453601837,
      "rmse_mean": 0.028917185962200165,
      "rotation_flip": 0.012345679104328156,
      "sparse_tokens": 11904.0,
      "step": 8585,
      "turn_loss": 0.3293805420398712,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.3989035495261104,
      "grad_norm": 0.5004454851150513,
      "learning_rate": 1.9040110999761458e-06,
      "loss": 0.1368,
      "mae_dtheta": 0.007370807696133852,
      "mae_dx": 0.0015889275819063187,
      "mae_dy": 0.0017135690432041883,
      "pose_mae_dtheta": 0.04965142160654068,
      "pose_mae_dx": 0.01564866676926613,
      "pose_mae_dy": 0.014616732485592365,
      "pose_rmse_dtheta": 0.1365906298160553,
      "pose_rmse_dx": 0.04017449915409088,
      "pose_rmse_dy": 0.03486930951476097,
      "pose_rmse_mean": 0.07054481655359268,
      "rmse_dtheta": 0.018481232225894928,
      "rmse_dx": 0.004382340703159571,
      "rmse_dy": 0.003976068925112486,
      "rmse_mean": 0.008946547284722328,
      "rotation_flip": 0.004538087639957666,
      "sparse_tokens": 32217.0,
      "step": 8586,
      "turn_loss": 0.05917172506451607,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.3989500092919532,
      "grad_norm": 0.42232245206832886,
      "learning_rate": 1.9029729554139798e-06,
      "loss": 0.0879,
      "mae_dtheta": 0.007761338725686073,
      "mae_dx": 0.0009494967525824904,
      "mae_dy": 0.0014212423702701926,
      "pose_mae_dtheta": 0.054201073944568634,
      "pose_mae_dx": 0.014349054545164108,
      "pose_mae_dy": 0.018639322370290756,
      "pose_rmse_dtheta": 0.1975352019071579,
      "pose_rmse_dx": 0.04099556431174278,
      "pose_rmse_dy": 0.046552762389183044,
      "pose_rmse_mean": 0.0950278490781784,
      "rmse_dtheta": 0.02161361835896969,
      "rmse_dx": 0.0031835446134209633,
      "rmse_dy": 0.0033352638129144907,
      "rmse_mean": 0.009377475827932358,
      "rotation_flip": 0.005067567341029644,
      "sparse_tokens": 32089.0,
      "step": 8587,
      "turn_loss": 0.05396835878491402,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.39899646905779595,
      "grad_norm": 0.49000322818756104,
      "learning_rate": 1.9019350274285759e-06,
      "loss": 0.0925,
      "mae_dtheta": 0.03219110891222954,
      "mae_dx": 0.010019739158451557,
      "mae_dy": 0.004860306158661842,
      "pose_mae_dtheta": 0.24049782752990723,
      "pose_mae_dx": 0.08099187165498734,
      "pose_mae_dy": 0.04307978227734566,
      "pose_rmse_dtheta": 0.4020940065383911,
      "pose_rmse_dx": 0.1853533834218979,
      "pose_rmse_dy": 0.08075719326734543,
      "pose_rmse_mean": 0.22273486852645874,
      "rmse_dtheta": 0.04475888982415199,
      "rmse_dx": 0.02115645259618759,
      "rmse_dy": 0.00801970437169075,
      "rmse_mean": 0.024645015597343445,
      "rotation_flip": 0.013513513840734959,
      "sparse_tokens": 5971.0,
      "step": 8588,
      "turn_loss": 0.2554183900356293,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.39904292882363873,
      "grad_norm": 0.7331683039665222,
      "learning_rate": 1.9008973160925192e-06,
      "loss": 0.1062,
      "mae_dtheta": 0.00965526420623064,
      "mae_dx": 0.002278531901538372,
      "mae_dy": 0.0015434790402650833,
      "pose_mae_dtheta": 0.06588153541088104,
      "pose_mae_dx": 0.024812009185552597,
      "pose_mae_dy": 0.020669830963015556,
      "pose_rmse_dtheta": 0.1872648298740387,
      "pose_rmse_dx": 0.09489519149065018,
      "pose_rmse_dy": 0.05489952862262726,
      "pose_rmse_mean": 0.11235319077968597,
      "rmse_dtheta": 0.023192256689071655,
      "rmse_dx": 0.009176081046462059,
      "rmse_dy": 0.003802949795499444,
      "rmse_mean": 0.012057097628712654,
      "rotation_flip": 0.00364815560169518,
      "sparse_tokens": 32137.0,
      "step": 8589,
      "turn_loss": 0.08614989370107651,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3990893885894815,
      "grad_norm": 0.3222057521343231,
      "learning_rate": 1.8998598214783759e-06,
      "loss": 0.076,
      "mae_dtheta": 0.01035140361636877,
      "mae_dx": 0.0018286172999069095,
      "mae_dy": 0.0032268143258988857,
      "pose_mae_dtheta": 0.06641095131635666,
      "pose_mae_dx": 0.02249445579946041,
      "pose_mae_dy": 0.03470820561051369,
      "pose_rmse_dtheta": 0.13299775123596191,
      "pose_rmse_dx": 0.07229916751384735,
      "pose_rmse_dy": 0.08932619541883469,
      "pose_rmse_mean": 0.09820770472288132,
      "rmse_dtheta": 0.019725413993000984,
      "rmse_dx": 0.006027859635651112,
      "rmse_dy": 0.008312336169183254,
      "rmse_mean": 0.01135520450770855,
      "rotation_flip": 0.006414825562387705,
      "sparse_tokens": 32105.0,
      "step": 8590,
      "turn_loss": 0.09516716003417969,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3991358483553243,
      "grad_norm": 0.46076133847236633,
      "learning_rate": 1.8988225436587005e-06,
      "loss": 0.0992,
      "mae_dtheta": 0.010985701344907284,
      "mae_dx": 0.0012691732263192534,
      "mae_dy": 0.0021723827812820673,
      "pose_mae_dtheta": 0.07255566865205765,
      "pose_mae_dx": 0.01743527501821518,
      "pose_mae_dy": 0.0276247076690197,
      "pose_rmse_dtheta": 0.19677451252937317,
      "pose_rmse_dx": 0.045724935829639435,
      "pose_rmse_dy": 0.06492974609136581,
      "pose_rmse_mean": 0.10247640311717987,
      "rmse_dtheta": 0.023385509848594666,
      "rmse_dx": 0.0038341658655554056,
      "rmse_dy": 0.004373585805296898,
      "rmse_mean": 0.010531088337302208,
      "rotation_flip": 0.003246753243729472,
      "sparse_tokens": 32105.0,
      "step": 8591,
      "turn_loss": 0.07451528310775757,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19803.0,
      "epoch": 0.39918230812116706,
      "grad_norm": 0.5678091049194336,
      "learning_rate": 1.897785482706027e-06,
      "loss": 0.1834,
      "mae_dtheta": 0.029283031821250916,
      "mae_dx": 0.0086717139929533,
      "mae_dy": 0.004808477126061916,
      "pose_mae_dtheta": 0.22469653189182281,
      "pose_mae_dx": 0.07691086828708649,
      "pose_mae_dy": 0.07115756720304489,
      "pose_rmse_dtheta": 0.38227102160453796,
      "pose_rmse_dx": 0.1975727379322052,
      "pose_rmse_dy": 0.13983312249183655,
      "pose_rmse_mean": 0.23989228904247284,
      "rmse_dtheta": 0.04537350311875343,
      "rmse_dx": 0.021294161677360535,
      "rmse_dy": 0.008467970415949821,
      "rmse_mean": 0.025045212358236313,
      "rotation_flip": 0.015673981979489326,
      "sparse_tokens": 16061.0,
      "step": 8592,
      "turn_loss": 0.2389172464609146,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.39922876788700984,
      "grad_norm": 0.46995067596435547,
      "learning_rate": 1.8967486386928819e-06,
      "loss": 0.0746,
      "mae_dtheta": 0.009506371803581715,
      "mae_dx": 0.001631398219615221,
      "mae_dy": 0.002067741472274065,
      "pose_mae_dtheta": 0.06607227027416229,
      "pose_mae_dx": 0.019312839955091476,
      "pose_mae_dy": 0.020577125251293182,
      "pose_rmse_dtheta": 0.21690838038921356,
      "pose_rmse_dx": 0.05490057170391083,
      "pose_rmse_dy": 0.04683976620435715,
      "pose_rmse_mean": 0.10621624439954758,
      "rmse_dtheta": 0.024685658514499664,
      "rmse_dx": 0.004709509667009115,
      "rmse_dy": 0.00450358958914876,
      "rmse_mean": 0.011299586854875088,
      "rotation_flip": 0.004741379525512457,
      "sparse_tokens": 32073.0,
      "step": 8593,
      "turn_loss": 0.0657472014427185,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.3992752276528526,
      "grad_norm": 0.46732330322265625,
      "learning_rate": 1.8957120116917682e-06,
      "loss": 0.0975,
      "mae_dtheta": 0.008983276784420013,
      "mae_dx": 0.0028960288036614656,
      "mae_dy": 0.0031668092124164104,
      "pose_mae_dtheta": 0.06268013268709183,
      "pose_mae_dx": 0.03140350431203842,
      "pose_mae_dy": 0.024394165724515915,
      "pose_rmse_dtheta": 0.17725737392902374,
      "pose_rmse_dx": 0.09275036305189133,
      "pose_rmse_dy": 0.06040257215499878,
      "pose_rmse_mean": 0.11013676971197128,
      "rmse_dtheta": 0.021874969825148582,
      "rmse_dx": 0.008478342555463314,
      "rmse_dy": 0.008283613249659538,
      "rmse_mean": 0.01287897489964962,
      "rotation_flip": 0.007393715437501669,
      "sparse_tokens": 32121.0,
      "step": 8594,
      "turn_loss": 0.09352714568376541,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3993216874186954,
      "grad_norm": 0.7723703980445862,
      "learning_rate": 1.8946756017751816e-06,
      "loss": 0.1376,
      "mae_dtheta": 0.007341446820646524,
      "mae_dx": 0.0010377787984907627,
      "mae_dy": 0.0012599426554515958,
      "pose_mae_dtheta": 0.044848062098026276,
      "pose_mae_dx": 0.0132509870454669,
      "pose_mae_dy": 0.015496592968702316,
      "pose_rmse_dtheta": 0.14940474927425385,
      "pose_rmse_dx": 0.03212428092956543,
      "pose_rmse_dy": 0.03841375559568405,
      "pose_rmse_mean": 0.07331426441669464,
      "rmse_dtheta": 0.020703373476862907,
      "rmse_dx": 0.002889542607590556,
      "rmse_dy": 0.002759563270956278,
      "rmse_mean": 0.008784160017967224,
      "rotation_flip": 0.01026785746216774,
      "sparse_tokens": 32105.0,
      "step": 8595,
      "turn_loss": 0.05609302222728729,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10731.0,
      "epoch": 0.39936814718453817,
      "grad_norm": 0.49723154306411743,
      "learning_rate": 1.8936394090155952e-06,
      "loss": 0.0949,
      "mae_dtheta": 0.030926695093512535,
      "mae_dx": 0.00867199432104826,
      "mae_dy": 0.005495018325746059,
      "pose_mae_dtheta": 0.24099883437156677,
      "pose_mae_dx": 0.049256015568971634,
      "pose_mae_dy": 0.06628813594579697,
      "pose_rmse_dtheta": 0.4734826982021332,
      "pose_rmse_dx": 0.0994972288608551,
      "pose_rmse_dy": 0.16253025829792023,
      "pose_rmse_mean": 0.24517005681991577,
      "rmse_dtheta": 0.04974299669265747,
      "rmse_dx": 0.018288394436240196,
      "rmse_dy": 0.012267367914319038,
      "rmse_mean": 0.026766253635287285,
      "rotation_flip": 0.010121457278728485,
      "sparse_tokens": 8851.0,
      "step": 8596,
      "turn_loss": 0.2543109655380249,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.39941460695038095,
      "grad_norm": 0.49399909377098083,
      "learning_rate": 1.8926034334854743e-06,
      "loss": 0.0788,
      "mae_dtheta": 0.006852643098682165,
      "mae_dx": 0.001911210478283465,
      "mae_dy": 0.0015358163509517908,
      "pose_mae_dtheta": 0.052790142595767975,
      "pose_mae_dx": 0.015743402764201164,
      "pose_mae_dy": 0.011552331037819386,
      "pose_rmse_dtheta": 0.21088406443595886,
      "pose_rmse_dx": 0.052275147289037704,
      "pose_rmse_dy": 0.03551549091935158,
      "pose_rmse_mean": 0.09955823421478271,
      "rmse_dtheta": 0.022959468886256218,
      "rmse_dx": 0.00708199106156826,
      "rmse_dy": 0.006009992677718401,
      "rmse_mean": 0.012017151340842247,
      "rotation_flip": 0.004645760636776686,
      "sparse_tokens": 32105.0,
      "step": 8597,
      "turn_loss": 0.06610123813152313,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29108.0,
      "epoch": 0.3994610667162237,
      "grad_norm": 0.37857189774513245,
      "learning_rate": 1.891567675257261e-06,
      "loss": 0.0935,
      "mae_dtheta": 0.03906003758311272,
      "mae_dx": 0.017087111249566078,
      "mae_dy": 0.005089572165161371,
      "pose_mae_dtheta": 0.3425349295139313,
      "pose_mae_dx": 0.12982508540153503,
      "pose_mae_dy": 0.06834284961223602,
      "pose_rmse_dtheta": 0.5760638117790222,
      "pose_rmse_dx": 0.2699708938598633,
      "pose_rmse_dy": 0.16106946766376495,
      "pose_rmse_mean": 0.3357014060020447,
      "rmse_dtheta": 0.05752606689929962,
      "rmse_dx": 0.030828379094600677,
      "rmse_dy": 0.009476772509515285,
      "rmse_mean": 0.03261040896177292,
      "rotation_flip": 0.011396011337637901,
      "sparse_tokens": 23787.0,
      "step": 8598,
      "turn_loss": 0.30656707286834717,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.39950752648206656,
      "grad_norm": 0.6502047777175903,
      "learning_rate": 1.89053213440339e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.02081444300711155,
      "mae_dx": 0.005733047146350145,
      "mae_dy": 0.0037635646294802427,
      "pose_mae_dtheta": 0.1933506280183792,
      "pose_mae_dx": 0.04192764312028885,
      "pose_mae_dy": 0.07110597938299179,
      "pose_rmse_dtheta": 0.4085994362831116,
      "pose_rmse_dx": 0.10482614487409592,
      "pose_rmse_dy": 0.16102385520935059,
      "pose_rmse_mean": 0.2248164862394333,
      "rmse_dtheta": 0.03917365148663521,
      "rmse_dx": 0.0162460058927536,
      "rmse_dy": 0.007201067637652159,
      "rmse_mean": 0.020873574540019035,
      "rotation_flip": 0.0,
      "sparse_tokens": 5088.0,
      "step": 8599,
      "turn_loss": 0.1281501054763794,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.39955398624790933,
      "grad_norm": 0.6056303977966309,
      "learning_rate": 1.8894968109962742e-06,
      "loss": 0.1714,
      "mae_dtheta": 0.011557185091078281,
      "mae_dx": 0.002865213667973876,
      "mae_dy": 0.002888923278078437,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6056304574012756,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.78564453125,
      "model/head/act_norm_mean": 109.15683128720238,
      "model/head/act_norm_min": 84.08016204833984,
      "model/head/act_over_embed": 75.01359640292095,
      "model/head/grad_frac": 0.12268733233213425,
      "model/head/grad_norm": 0.07430318742990494,
      "model/head/grad_zero_frac": 0.0001792585535440594,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6883835565476191,
      "model/head/update_ratio": 0.001265533035621047,
      "model/head/weight_delta": 9.79735279083252,
      "model/head/weight_delta_rel": 0.17187458276748657,
      "model/head/weight_norm": 58.71295928955078,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4223766326904297,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42232331362637604,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42227041721343994,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29022453497720174,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0938650369644165,
      "model/modality_embedder.encoders.pose/grad_norm": 0.056847523897886276,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5466086647727273,
      "model/modality_embedder.encoders.pose/update_ratio": 0.00183568662032485,
      "model/modality_embedder.encoders.pose/weight_delta": 3.119093179702759,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10191049426794052,
      "model/modality_embedder.encoders.pose/weight_norm": 30.967988967895508,
      "model/modality_embedder/grad_frac": 0.0938650369644165,
      "model/modality_embedder/grad_norm": 0.056847523897886276,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5466086647727273,
      "model/modality_embedder/update_ratio": 0.00183568662032485,
      "model/modality_embedder/weight_delta": 3.119093179702759,
      "model/modality_embedder/weight_delta_rel": 0.10191049426794052,
      "model/modality_embedder/weight_norm": 30.967988967895508,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.37288665771484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.610122000188966,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.273425102233887,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.225096879974586,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08655258268117905,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05241888016462326,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018761337269097567,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.648113965988159,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09649886935949326,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.939842224121094,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.14311218261719,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.459229438303097,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.854677200317383,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.8086114609157,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07967934012413025,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04825623333454132,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016227661399170756,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.357670307159424,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11631232500076294,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.737022399902344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.78042602539062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.219747968631896,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.271505355834961,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.018456277191813,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07536479830741882,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.045643217861652374,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014864839613437653,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.632152557373047,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12196088582277298,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.705490112304688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 75.5254898071289,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.056399990551775,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.9757080078125,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.280620741662297,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06719712167978287,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04069662466645241,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013598463265225291,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1152849197387695,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1064656525850296,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.927370071411133,
      "model/normalizer/grad_frac": 0.26561638712882996,
      "model/normalizer/grad_norm": 0.16086536645889282,
      "model/normalizer/grad_zero_frac": 0.00022453030396718532,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00204611849039793,
      "model/normalizer/weight_delta": 6.566766262054443,
      "model/normalizer/weight_delta_rel": 0.08457614481449127,
      "model/normalizer/weight_norm": 78.6197738647461,
      "pose_mae_dtheta": 0.07337916642427444,
      "pose_mae_dx": 0.025499772280454636,
      "pose_mae_dy": 0.03341817110776901,
      "pose_rmse_dtheta": 0.12937061488628387,
      "pose_rmse_dx": 0.06879710406064987,
      "pose_rmse_dy": 0.07799743860960007,
      "pose_rmse_mean": 0.0920550525188446,
      "rmse_dtheta": 0.022739006206393242,
      "rmse_dx": 0.00680083641782403,
      "rmse_dy": 0.005877215415239334,
      "rmse_mean": 0.011805686168372631,
      "rotation_flip": 0.0031847134232521057,
      "sparse_tokens": 5815.0,
      "step": 8600,
      "turn_loss": 0.12637503445148468,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "epoch": 0.39955398624790933,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3028086721897125,
      "eval_objectnav_nopose_mae_dtheta": 0.04001249745488167,
      "eval_objectnav_nopose_mae_dx": 0.012976450845599174,
      "eval_objectnav_nopose_mae_dy": 0.004846755415201187,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31940892338752747,
      "eval_objectnav_nopose_pose_mae_dx": 0.10546816140413284,
      "eval_objectnav_nopose_pose_mae_dy": 0.05415257439017296,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5402419567108154,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2318294793367386,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1283225566148758,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30013132095336914,
      "eval_objectnav_nopose_rmse_dtheta": 0.05784790217876434,
      "eval_objectnav_nopose_rmse_dx": 0.02572615258395672,
      "eval_objectnav_nopose_rmse_dy": 0.009949498809874058,
      "eval_objectnav_nopose_rmse_mean": 0.031174518167972565,
      "eval_objectnav_nopose_rotation_flip": 0.015334106981754303,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3028086721897125,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 8600
    },
    {
      "epoch": 0.39955398624790933,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2728120982646942,
      "eval_objectnav_pose_mae_dtheta": 0.03553367406129837,
      "eval_objectnav_pose_mae_dx": 0.011528470553457737,
      "eval_objectnav_pose_mae_dy": 0.00451334472745657,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2672116160392761,
      "eval_objectnav_pose_pose_mae_dx": 0.09051140397787094,
      "eval_objectnav_pose_pose_mae_dy": 0.047752924263477325,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4715312719345093,
      "eval_objectnav_pose_pose_rmse_dx": 0.21069560945034027,
      "eval_objectnav_pose_pose_rmse_dy": 0.1177414134144783,
      "eval_objectnav_pose_pose_rmse_mean": 0.2666561007499695,
      "eval_objectnav_pose_rmse_dtheta": 0.0535135343670845,
      "eval_objectnav_pose_rmse_dx": 0.02393747679889202,
      "eval_objectnav_pose_rmse_dy": 0.009486651048064232,
      "eval_objectnav_pose_rmse_mean": 0.02897922322154045,
      "eval_objectnav_pose_rotation_flip": 0.015351483598351479,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2728120982646942,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 8600
    },
    {
      "epoch": 0.39955398624790933,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08981768041849136,
      "eval_pointnav_mae_dtheta": 0.010073510929942131,
      "eval_pointnav_mae_dx": 0.0022900011390447617,
      "eval_pointnav_mae_dy": 0.0022519261110574007,
      "eval_pointnav_pose_mae_dtheta": 0.06879375874996185,
      "eval_pointnav_pose_mae_dx": 0.024860668927431107,
      "eval_pointnav_pose_mae_dy": 0.0239686518907547,
      "eval_pointnav_pose_rmse_dtheta": 0.19835062325000763,
      "eval_pointnav_pose_rmse_dx": 0.07726925611495972,
      "eval_pointnav_pose_rmse_dy": 0.06832439452409744,
      "eval_pointnav_pose_rmse_mean": 0.11464808881282806,
      "eval_pointnav_rmse_dtheta": 0.024906275793910027,
      "eval_pointnav_rmse_dx": 0.007337209302932024,
      "eval_pointnav_rmse_dy": 0.006060974672436714,
      "eval_pointnav_rmse_mean": 0.012768154963850975,
      "eval_pointnav_rotation_flip": 0.004698354285210371,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08981768041849136,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 8600
    },
    {
      "epoch": 0.39955398624790933,
      "eval_loss": 0.2218128169576327,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3028086721897125,
      "eval_objectnav_nopose_mae_dtheta": 0.04001249745488167,
      "eval_objectnav_nopose_mae_dx": 0.012976450845599174,
      "eval_objectnav_nopose_mae_dy": 0.004846755415201187,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31940892338752747,
      "eval_objectnav_nopose_pose_mae_dx": 0.10546816140413284,
      "eval_objectnav_nopose_pose_mae_dy": 0.05415257439017296,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5402419567108154,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2318294793367386,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1283225566148758,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30013132095336914,
      "eval_objectnav_nopose_rmse_dtheta": 0.05784790217876434,
      "eval_objectnav_nopose_rmse_dx": 0.02572615258395672,
      "eval_objectnav_nopose_rmse_dy": 0.009949498809874058,
      "eval_objectnav_nopose_rmse_mean": 0.031174518167972565,
      "eval_objectnav_nopose_rotation_flip": 0.015334106981754303,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3028086721897125,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2728120982646942,
      "eval_objectnav_pose_mae_dtheta": 0.03553367406129837,
      "eval_objectnav_pose_mae_dx": 0.011528470553457737,
      "eval_objectnav_pose_mae_dy": 0.00451334472745657,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2672116160392761,
      "eval_objectnav_pose_pose_mae_dx": 0.09051140397787094,
      "eval_objectnav_pose_pose_mae_dy": 0.047752924263477325,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4715312719345093,
      "eval_objectnav_pose_pose_rmse_dx": 0.21069560945034027,
      "eval_objectnav_pose_pose_rmse_dy": 0.1177414134144783,
      "eval_objectnav_pose_pose_rmse_mean": 0.2666561007499695,
      "eval_objectnav_pose_rmse_dtheta": 0.0535135343670845,
      "eval_objectnav_pose_rmse_dx": 0.02393747679889202,
      "eval_objectnav_pose_rmse_dy": 0.009486651048064232,
      "eval_objectnav_pose_rmse_mean": 0.02897922322154045,
      "eval_objectnav_pose_rotation_flip": 0.015351483598351479,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2728120982646942,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08981768041849136,
      "eval_pointnav_mae_dtheta": 0.010073510929942131,
      "eval_pointnav_mae_dx": 0.0022900011390447617,
      "eval_pointnav_mae_dy": 0.0022519261110574007,
      "eval_pointnav_pose_mae_dtheta": 0.06879375874996185,
      "eval_pointnav_pose_mae_dx": 0.024860668927431107,
      "eval_pointnav_pose_mae_dy": 0.0239686518907547,
      "eval_pointnav_pose_rmse_dtheta": 0.19835062325000763,
      "eval_pointnav_pose_rmse_dx": 0.07726925611495972,
      "eval_pointnav_pose_rmse_dy": 0.06832439452409744,
      "eval_pointnav_pose_rmse_mean": 0.11464808881282806,
      "eval_pointnav_rmse_dtheta": 0.024906275793910027,
      "eval_pointnav_rmse_dx": 0.007337209302932024,
      "eval_pointnav_rmse_dy": 0.006060974672436714,
      "eval_pointnav_rmse_mean": 0.012768154963850975,
      "eval_pointnav_rotation_flip": 0.004698354285210371,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08981768041849136,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 8600
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.3996004460137521,
      "grad_norm": 0.4800679385662079,
      "learning_rate": 1.8884617051083183e-06,
      "loss": 0.1371,
      "mae_dtheta": 0.030329285189509392,
      "mae_dx": 0.012926734983921051,
      "mae_dy": 0.007514822296798229,
      "pose_mae_dtheta": 0.1886446475982666,
      "pose_mae_dx": 0.08073664456605911,
      "pose_mae_dy": 0.11205042898654938,
      "pose_rmse_dtheta": 0.3063661754131317,
      "pose_rmse_dx": 0.17196257412433624,
      "pose_rmse_dy": 0.214467391371727,
      "pose_rmse_mean": 0.2309320569038391,
      "rmse_dtheta": 0.0459962859749794,
      "rmse_dx": 0.02657272294163704,
      "rmse_dy": 0.012379152700304985,
      "rmse_mean": 0.028316056355834007,
      "rotation_flip": 0.016706444323062897,
      "sparse_tokens": 6643.0,
      "step": 8601,
      "turn_loss": 0.27388203144073486,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.3996469057795949,
      "grad_norm": 0.6500082015991211,
      "learning_rate": 1.887426816811903e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.04468991234898567,
      "mae_dx": 0.019532598555088043,
      "mae_dy": 0.007834152318537235,
      "pose_mae_dtheta": 0.3181093633174896,
      "pose_mae_dx": 0.14701630175113678,
      "pose_mae_dy": 0.09609595686197281,
      "pose_rmse_dtheta": 0.5125552415847778,
      "pose_rmse_dx": 0.3180731534957886,
      "pose_rmse_dy": 0.20191629230976105,
      "pose_rmse_mean": 0.3441815972328186,
      "rmse_dtheta": 0.06003231555223465,
      "rmse_dx": 0.034246575087308884,
      "rmse_dy": 0.014883801341056824,
      "rmse_mean": 0.03638756275177002,
      "rotation_flip": 0.01826483942568302,
      "sparse_tokens": 7117.0,
      "step": 8602,
      "turn_loss": 0.40263521671295166,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.39969336554543766,
      "grad_norm": 0.762832760810852,
      "learning_rate": 1.8863921461794028e-06,
      "loss": 0.1572,
      "mae_dtheta": 0.029022468253970146,
      "mae_dx": 0.012886340729892254,
      "mae_dy": 0.0052649942226707935,
      "pose_mae_dtheta": 0.2301536649465561,
      "pose_mae_dx": 0.09695231169462204,
      "pose_mae_dy": 0.06076667085289955,
      "pose_rmse_dtheta": 0.38169893622398376,
      "pose_rmse_dx": 0.206316739320755,
      "pose_rmse_dy": 0.13070784509181976,
      "pose_rmse_mean": 0.23957452178001404,
      "rmse_dtheta": 0.04245637729763985,
      "rmse_dx": 0.025706002488732338,
      "rmse_dy": 0.009347056038677692,
      "rmse_mean": 0.025836480781435966,
      "rotation_flip": 0.020183486863970757,
      "sparse_tokens": 9798.0,
      "step": 8603,
      "turn_loss": 0.25610536336898804,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.39973982531128044,
      "grad_norm": 0.7162351012229919,
      "learning_rate": 1.8853576932831696e-06,
      "loss": 0.1463,
      "mae_dtheta": 0.027092453092336655,
      "mae_dx": 0.007236413657665253,
      "mae_dy": 0.0052208672277629375,
      "pose_mae_dtheta": 0.2181946337223053,
      "pose_mae_dx": 0.07298607379198074,
      "pose_mae_dy": 0.0773598849773407,
      "pose_rmse_dtheta": 0.37976381182670593,
      "pose_rmse_dx": 0.16459587216377258,
      "pose_rmse_dy": 0.15604838728904724,
      "pose_rmse_mean": 0.23346936702728271,
      "rmse_dtheta": 0.040606457740068436,
      "rmse_dx": 0.017776628956198692,
      "rmse_dy": 0.009852046146988869,
      "rmse_mean": 0.0227450430393219,
      "rotation_flip": 0.01666666753590107,
      "sparse_tokens": 12091.0,
      "step": 8604,
      "turn_loss": 0.21398134529590607,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 1658.0,
      "epoch": 0.3997862850771232,
      "grad_norm": 0.5938054919242859,
      "learning_rate": 1.8843234581955444e-06,
      "loss": 0.1465,
      "mae_dtheta": 0.02486494742333889,
      "mae_dx": 0.010859736241400242,
      "mae_dy": 0.004355435259640217,
      "pose_mae_dtheta": 0.1366903930902481,
      "pose_mae_dx": 0.09486117959022522,
      "pose_mae_dy": 0.055004239082336426,
      "pose_rmse_dtheta": 0.1717265546321869,
      "pose_rmse_dx": 0.23619942367076874,
      "pose_rmse_dy": 0.09874336421489716,
      "pose_rmse_mean": 0.16888979077339172,
      "rmse_dtheta": 0.03378068283200264,
      "rmse_dx": 0.02568838931620121,
      "rmse_dy": 0.007955851033329964,
      "rmse_mean": 0.022474974393844604,
      "rotation_flip": 0.014084506779909134,
      "sparse_tokens": 1447.0,
      "step": 8605,
      "turn_loss": 0.1320217400789261,
      "turns": 5.0,
      "turns_per_sample": 5.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.399832744842966,
      "grad_norm": 0.5307035446166992,
      "learning_rate": 1.883289440988854e-06,
      "loss": 0.0895,
      "mae_dtheta": 0.009157365188002586,
      "mae_dx": 0.0016106071416288614,
      "mae_dy": 0.002088627079501748,
      "pose_mae_dtheta": 0.06070530414581299,
      "pose_mae_dx": 0.017961712554097176,
      "pose_mae_dy": 0.023963341489434242,
      "pose_rmse_dtheta": 0.17639173567295074,
      "pose_rmse_dx": 0.04745893180370331,
      "pose_rmse_dy": 0.059126608073711395,
      "pose_rmse_mean": 0.09432576596736908,
      "rmse_dtheta": 0.0234646275639534,
      "rmse_dx": 0.005056405905634165,
      "rmse_dy": 0.004948945716023445,
      "rmse_mean": 0.011156659573316574,
      "rotation_flip": 0.0018700327491387725,
      "sparse_tokens": 32073.0,
      "step": 8606,
      "turn_loss": 0.06598415970802307,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.39987920460880877,
      "grad_norm": 0.3138919770717621,
      "learning_rate": 1.8822556417354038e-06,
      "loss": 0.0587,
      "mae_dtheta": 0.00946544948965311,
      "mae_dx": 0.0011585925240069628,
      "mae_dy": 0.001084001618437469,
      "pose_mae_dtheta": 0.06456609815359116,
      "pose_mae_dx": 0.012550893239676952,
      "pose_mae_dy": 0.014343089424073696,
      "pose_rmse_dtheta": 0.2176666557788849,
      "pose_rmse_dx": 0.02899615652859211,
      "pose_rmse_dy": 0.03934783115983009,
      "pose_rmse_mean": 0.09533688426017761,
      "rmse_dtheta": 0.026936480775475502,
      "rmse_dx": 0.0035938452929258347,
      "rmse_dy": 0.0025725143495947123,
      "rmse_mean": 0.011034280061721802,
      "rotation_flip": 0.0016194331692531705,
      "sparse_tokens": 32169.0,
      "step": 8607,
      "turn_loss": 0.05532369762659073,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.39992566437465155,
      "grad_norm": 0.42632561922073364,
      "learning_rate": 1.881222060507492e-06,
      "loss": 0.1042,
      "mae_dtheta": 0.040293626487255096,
      "mae_dx": 0.012392332777380943,
      "mae_dy": 0.008077137172222137,
      "pose_mae_dtheta": 0.3108689486980438,
      "pose_mae_dx": 0.09887300431728363,
      "pose_mae_dy": 0.07229065150022507,
      "pose_rmse_dtheta": 0.5448411703109741,
      "pose_rmse_dx": 0.21335674822330475,
      "pose_rmse_dy": 0.184965580701828,
      "pose_rmse_mean": 0.31438785791397095,
      "rmse_dtheta": 0.060374826192855835,
      "rmse_dx": 0.023751333355903625,
      "rmse_dy": 0.016940223053097725,
      "rmse_mean": 0.03368879482150078,
      "rotation_flip": 0.017882689833641052,
      "sparse_tokens": 21210.0,
      "step": 8608,
      "turn_loss": 0.2939012348651886,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.3999721241404943,
      "grad_norm": 0.45581042766571045,
      "learning_rate": 1.8801886973773936e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.009557809680700302,
      "mae_dx": 0.0011156991822645068,
      "mae_dy": 0.0021111415699124336,
      "pose_mae_dtheta": 0.06236166134476662,
      "pose_mae_dx": 0.016752440482378006,
      "pose_mae_dy": 0.027303380891680717,
      "pose_rmse_dtheta": 0.1461523026227951,
      "pose_rmse_dx": 0.0419081375002861,
      "pose_rmse_dy": 0.07631811499595642,
      "pose_rmse_mean": 0.08812618255615234,
      "rmse_dtheta": 0.020936354994773865,
      "rmse_dx": 0.003120630979537964,
      "rmse_dy": 0.004743319470435381,
      "rmse_mean": 0.009600101970136166,
      "rotation_flip": 0.001991238445043564,
      "sparse_tokens": 32105.0,
      "step": 8609,
      "turn_loss": 0.07582414895296097,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4000185839063371,
      "grad_norm": 0.6935022473335266,
      "learning_rate": 1.879155552417376e-06,
      "loss": 0.0613,
      "mae_dtheta": 0.006449475418776274,
      "mae_dx": 0.0009674077155068517,
      "mae_dy": 0.000861587468534708,
      "pose_mae_dtheta": 0.04467135667800903,
      "pose_mae_dx": 0.009402995929121971,
      "pose_mae_dy": 0.011031363159418106,
      "pose_rmse_dtheta": 0.18325373530387878,
      "pose_rmse_dx": 0.022424902766942978,
      "pose_rmse_dy": 0.029262734577059746,
      "pose_rmse_mean": 0.07831379771232605,
      "rmse_dtheta": 0.021896783262491226,
      "rmse_dx": 0.0027905029710382223,
      "rmse_dy": 0.00195976416580379,
      "rmse_mean": 0.008882350288331509,
      "rotation_flip": 0.002288329415023327,
      "sparse_tokens": 32153.0,
      "step": 8610,
      "turn_loss": 0.042290978133678436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4000650436721799,
      "grad_norm": 0.37393873929977417,
      "learning_rate": 1.8781226256996838e-06,
      "loss": 0.078,
      "mae_dtheta": 0.011797650717198849,
      "mae_dx": 0.002343051368370652,
      "mae_dy": 0.003967272583395243,
      "pose_mae_dtheta": 0.08880607783794403,
      "pose_mae_dx": 0.03975050151348114,
      "pose_mae_dy": 0.04288414120674133,
      "pose_rmse_dtheta": 0.19928601384162903,
      "pose_rmse_dx": 0.10480444133281708,
      "pose_rmse_dy": 0.09587210416793823,
      "pose_rmse_mean": 0.1333208531141281,
      "rmse_dtheta": 0.02401569113135338,
      "rmse_dx": 0.005672106985002756,
      "rmse_dy": 0.00856354832649231,
      "rmse_mean": 0.01275044959038496,
      "rotation_flip": 0.0013927576364949346,
      "sparse_tokens": 32121.0,
      "step": 8611,
      "turn_loss": 0.12371639162302017,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17481.0,
      "epoch": 0.40011150343802265,
      "grad_norm": 0.5940819978713989,
      "learning_rate": 1.8770899172965517e-06,
      "loss": 0.1128,
      "mae_dtheta": 0.03214418515563011,
      "mae_dx": 0.01835128851234913,
      "mae_dy": 0.004975747782737017,
      "pose_mae_dtheta": 0.25185707211494446,
      "pose_mae_dx": 0.16184377670288086,
      "pose_mae_dy": 0.07400082796812057,
      "pose_rmse_dtheta": 0.4459821879863739,
      "pose_rmse_dx": 0.3232179880142212,
      "pose_rmse_dy": 0.1583651900291443,
      "pose_rmse_mean": 0.30918848514556885,
      "rmse_dtheta": 0.04975853115320206,
      "rmse_dx": 0.03356190770864487,
      "rmse_dy": 0.008877603337168694,
      "rmse_mean": 0.03073268197476864,
      "rotation_flip": 0.011642949655652046,
      "sparse_tokens": 14254.0,
      "step": 8612,
      "turn_loss": 0.22870127856731415,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.40015796320386543,
      "grad_norm": 0.46559736132621765,
      "learning_rate": 1.8760574272802002e-06,
      "loss": 0.0889,
      "mae_dtheta": 0.007995144464075565,
      "mae_dx": 0.0012662723893299699,
      "mae_dy": 0.0016162674874067307,
      "pose_mae_dtheta": 0.054005011916160583,
      "pose_mae_dx": 0.017392732203006744,
      "pose_mae_dy": 0.019583282992243767,
      "pose_rmse_dtheta": 0.15661360323429108,
      "pose_rmse_dx": 0.039103541523218155,
      "pose_rmse_dy": 0.04988993704319,
      "pose_rmse_mean": 0.08186902850866318,
      "rmse_dtheta": 0.019245442003011703,
      "rmse_dx": 0.003579098731279373,
      "rmse_dy": 0.0033933341037482023,
      "rmse_mean": 0.008739291690289974,
      "rotation_flip": 0.0016334530664607882,
      "sparse_tokens": 32185.0,
      "step": 8613,
      "turn_loss": 0.06783189624547958,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4002044229697082,
      "grad_norm": 0.5051848888397217,
      "learning_rate": 1.8750251557228271e-06,
      "loss": 0.0676,
      "mae_dtheta": 0.00579304713755846,
      "mae_dx": 0.0010438408935442567,
      "mae_dy": 0.0006555138970725238,
      "pose_mae_dtheta": 0.042441945523023605,
      "pose_mae_dx": 0.009380160830914974,
      "pose_mae_dy": 0.010003292933106422,
      "pose_rmse_dtheta": 0.17383792996406555,
      "pose_rmse_dx": 0.02291984111070633,
      "pose_rmse_dy": 0.027946697548031807,
      "pose_rmse_mean": 0.07490149140357971,
      "rmse_dtheta": 0.02056136354804039,
      "rmse_dx": 0.0031984555535018444,
      "rmse_dy": 0.001480844453908503,
      "rmse_mean": 0.008413555100560188,
      "rotation_flip": 0.0018921475857496262,
      "sparse_tokens": 32185.0,
      "step": 8614,
      "turn_loss": 0.03392387926578522,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25959.0,
      "epoch": 0.40025088273555104,
      "grad_norm": 0.3919784724712372,
      "learning_rate": 1.873993102696624e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.02670641988515854,
      "mae_dx": 0.009900243021547794,
      "mae_dy": 0.0032101785764098167,
      "pose_mae_dtheta": 0.20102551579475403,
      "pose_mae_dx": 0.08693761378526688,
      "pose_mae_dy": 0.03719332441687584,
      "pose_rmse_dtheta": 0.40272340178489685,
      "pose_rmse_dx": 0.19323323667049408,
      "pose_rmse_dy": 0.09509077668190002,
      "pose_rmse_mean": 0.23034915328025818,
      "rmse_dtheta": 0.04674004018306732,
      "rmse_dx": 0.0209331177175045,
      "rmse_dy": 0.006624389905482531,
      "rmse_mean": 0.024765852838754654,
      "rotation_flip": 0.008936550468206406,
      "sparse_tokens": 18652.0,
      "step": 8615,
      "turn_loss": 0.18777874112129211,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 34064.0,
      "epoch": 0.4002973425013938,
      "grad_norm": 0.8834277987480164,
      "learning_rate": 1.8729612682737598e-06,
      "loss": 0.2964,
      "mae_dtheta": 0.028525734320282936,
      "mae_dx": 0.009244628250598907,
      "mae_dy": 0.005653172265738249,
      "pose_mae_dtheta": 0.20477496087551117,
      "pose_mae_dx": 0.06695237010717392,
      "pose_mae_dy": 0.07414093613624573,
      "pose_rmse_dtheta": 0.3663373291492462,
      "pose_rmse_dx": 0.1607971042394638,
      "pose_rmse_dy": 0.16589853167533875,
      "pose_rmse_mean": 0.23101100325584412,
      "rmse_dtheta": 0.04486558958888054,
      "rmse_dx": 0.021035663783550262,
      "rmse_dy": 0.010563075542449951,
      "rmse_mean": 0.02548810839653015,
      "rotation_flip": 0.014197531156241894,
      "sparse_tokens": 27307.0,
      "step": 8616,
      "turn_loss": 0.2712060213088989,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4003438022672366,
      "grad_norm": 0.5878142714500427,
      "learning_rate": 1.8719296525263925e-06,
      "loss": 0.1609,
      "mae_dtheta": 0.014492025598883629,
      "mae_dx": 0.001787867397069931,
      "mae_dy": 0.0037771123461425304,
      "pose_mae_dtheta": 0.09125011414289474,
      "pose_mae_dx": 0.030218321830034256,
      "pose_mae_dy": 0.04124758020043373,
      "pose_rmse_dtheta": 0.227847158908844,
      "pose_rmse_dx": 0.08024263381958008,
      "pose_rmse_dy": 0.10279980301856995,
      "pose_rmse_mean": 0.13696320354938507,
      "rmse_dtheta": 0.029332991689443588,
      "rmse_dx": 0.0049783107824623585,
      "rmse_dy": 0.008787729777395725,
      "rmse_mean": 0.01436634361743927,
      "rotation_flip": 0.005496392957866192,
      "sparse_tokens": 32105.0,
      "step": 8617,
      "turn_loss": 0.11602999269962311,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.40039026203307937,
      "grad_norm": 0.49282562732696533,
      "learning_rate": 1.8708982555266646e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.010160495527088642,
      "mae_dx": 0.0021864566951990128,
      "mae_dy": 0.0022107164841145277,
      "pose_mae_dtheta": 0.06560730934143066,
      "pose_mae_dx": 0.02297278121113777,
      "pose_mae_dy": 0.024008531123399734,
      "pose_rmse_dtheta": 0.15972402691841125,
      "pose_rmse_dx": 0.06425502896308899,
      "pose_rmse_dy": 0.05783555284142494,
      "pose_rmse_mean": 0.0939382016658783,
      "rmse_dtheta": 0.022518616169691086,
      "rmse_dx": 0.00743363332003355,
      "rmse_dy": 0.00482124974951148,
      "rmse_mean": 0.011591166257858276,
      "rotation_flip": 0.004189359024167061,
      "sparse_tokens": 32073.0,
      "step": 8618,
      "turn_loss": 0.07905858755111694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.40043672179892215,
      "grad_norm": 0.4580596685409546,
      "learning_rate": 1.8698670773467003e-06,
      "loss": 0.0814,
      "mae_dtheta": 0.012181021273136139,
      "mae_dx": 0.0017878948710858822,
      "mae_dy": 0.002834711689502001,
      "pose_mae_dtheta": 0.0821492150425911,
      "pose_mae_dx": 0.022976117208600044,
      "pose_mae_dy": 0.02986983396112919,
      "pose_rmse_dtheta": 0.2516639530658722,
      "pose_rmse_dx": 0.06254246830940247,
      "pose_rmse_dy": 0.08771302551031113,
      "pose_rmse_mean": 0.1339731514453888,
      "rmse_dtheta": 0.029284588992595673,
      "rmse_dx": 0.0049361782148480415,
      "rmse_dy": 0.007178960833698511,
      "rmse_mean": 0.013799909502267838,
      "rotation_flip": 0.007874015718698502,
      "sparse_tokens": 32153.0,
      "step": 8619,
      "turn_loss": 0.10995206236839294,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20776.0,
      "epoch": 0.4004831815647649,
      "grad_norm": 0.4879951477050781,
      "learning_rate": 1.8688361180586123e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.027686655521392822,
      "mae_dx": 0.00865723006427288,
      "mae_dy": 0.004044540226459503,
      "pose_mae_dtheta": 0.2120252102613449,
      "pose_mae_dx": 0.07602991908788681,
      "pose_mae_dy": 0.03630298003554344,
      "pose_rmse_dtheta": 0.4378538131713867,
      "pose_rmse_dx": 0.17893047630786896,
      "pose_rmse_dy": 0.10618419945240021,
      "pose_rmse_mean": 0.24098949134349823,
      "rmse_dtheta": 0.05020616948604584,
      "rmse_dx": 0.01971888355910778,
      "rmse_dy": 0.012223543599247932,
      "rmse_mean": 0.02738286554813385,
      "rotation_flip": 0.013528748415410519,
      "sparse_tokens": 16409.0,
      "step": 8620,
      "turn_loss": 0.184030219912529,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.4005296413306077,
      "grad_norm": 0.4826992452144623,
      "learning_rate": 1.867805377734494e-06,
      "loss": 0.1287,
      "mae_dtheta": 0.03431292995810509,
      "mae_dx": 0.01400819979608059,
      "mae_dy": 0.00392515491694212,
      "pose_mae_dtheta": 0.2519807815551758,
      "pose_mae_dx": 0.10584033280611038,
      "pose_mae_dy": 0.0475897416472435,
      "pose_rmse_dtheta": 0.4926935136318207,
      "pose_rmse_dx": 0.24858835339546204,
      "pose_rmse_dy": 0.11740565299987793,
      "pose_rmse_mean": 0.2862291932106018,
      "rmse_dtheta": 0.054079849272966385,
      "rmse_dx": 0.027195094153285027,
      "rmse_dy": 0.007602108642458916,
      "rmse_mean": 0.029625684022903442,
      "rotation_flip": 0.010849909856915474,
      "sparse_tokens": 18296.0,
      "step": 8621,
      "turn_loss": 0.2700181007385254,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4005761010964505,
      "grad_norm": 0.5310826301574707,
      "learning_rate": 1.8667748564464282e-06,
      "loss": 0.1085,
      "mae_dtheta": 0.008453612215816975,
      "mae_dx": 0.0019928195979446173,
      "mae_dy": 0.001874417532235384,
      "pose_mae_dtheta": 0.057171545922756195,
      "pose_mae_dx": 0.02136441320180893,
      "pose_mae_dy": 0.0221078060567379,
      "pose_rmse_dtheta": 0.13344894349575043,
      "pose_rmse_dx": 0.0690484270453453,
      "pose_rmse_dy": 0.05005074292421341,
      "pose_rmse_mean": 0.08418270200490952,
      "rmse_dtheta": 0.017425507307052612,
      "rmse_dx": 0.006842111703008413,
      "rmse_dy": 0.004135074093937874,
      "rmse_mean": 0.009467564523220062,
      "rotation_flip": 0.003832886228337884,
      "sparse_tokens": 32137.0,
      "step": 8622,
      "turn_loss": 0.07291879504919052,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.40062256086229325,
      "grad_norm": 0.3934435546398163,
      "learning_rate": 1.865744554266477e-06,
      "loss": 0.0694,
      "mae_dtheta": 0.007508413400501013,
      "mae_dx": 0.001441697240807116,
      "mae_dy": 0.0017529100878164172,
      "pose_mae_dtheta": 0.05362839624285698,
      "pose_mae_dx": 0.017296679317951202,
      "pose_mae_dy": 0.021447397768497467,
      "pose_rmse_dtheta": 0.1531134843826294,
      "pose_rmse_dx": 0.05070032551884651,
      "pose_rmse_dy": 0.0656450018286705,
      "pose_rmse_mean": 0.08981960266828537,
      "rmse_dtheta": 0.019773874431848526,
      "rmse_dx": 0.004785808268934488,
      "rmse_dy": 0.004526811186224222,
      "rmse_mean": 0.009695498272776604,
      "rotation_flip": 0.0010840108152478933,
      "sparse_tokens": 32089.0,
      "step": 8623,
      "turn_loss": 0.055504731833934784,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.40066902062813603,
      "grad_norm": 0.5638124346733093,
      "learning_rate": 1.8647144712666909e-06,
      "loss": 0.1824,
      "mae_dtheta": 0.00802631676197052,
      "mae_dx": 0.0014082627603784204,
      "mae_dy": 0.0016079643974080682,
      "pose_mae_dtheta": 0.06295450776815414,
      "pose_mae_dx": 0.02065253257751465,
      "pose_mae_dy": 0.024255065247416496,
      "pose_rmse_dtheta": 0.1906786561012268,
      "pose_rmse_dx": 0.05799214914441109,
      "pose_rmse_dy": 0.06494365632534027,
      "pose_rmse_mean": 0.10453815758228302,
      "rmse_dtheta": 0.020599989220499992,
      "rmse_dx": 0.0050257849507033825,
      "rmse_dy": 0.003699482185766101,
      "rmse_mean": 0.009775085374712944,
      "rotation_flip": 0.0031298904214054346,
      "sparse_tokens": 32057.0,
      "step": 8624,
      "turn_loss": 0.055212296545505524,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4007154803939788,
      "grad_norm": 0.33335715532302856,
      "learning_rate": 1.8636846075191067e-06,
      "loss": 0.0849,
      "mae_dtheta": 0.007101769093424082,
      "mae_dx": 0.0012638380285352468,
      "mae_dy": 0.001923196017742157,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3333572447299957,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.1343536376953,
      "model/head/act_norm_mean": 116.1026278409091,
      "model/head/act_norm_min": 74.2913818359375,
      "model/head/act_over_embed": 79.78681282220006,
      "model/head/grad_frac": 0.11155631393194199,
      "model/head/grad_norm": 0.037188105285167694,
      "model/head/grad_zero_frac": 0.00019702577264979482,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7083185369318182,
      "model/head/update_ratio": 0.0006333797937259078,
      "model/head/weight_delta": 9.801974296569824,
      "model/head/weight_delta_rel": 0.1719556599855423,
      "model/head/weight_norm": 58.71375274658203,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42243361473083496,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4223648837712257,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4223020076751709,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2902531023699283,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07934549450874329,
      "model/modality_embedder.encoders.pose/grad_norm": 0.026450395584106445,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5293949771689498,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0008541181450709701,
      "model/modality_embedder.encoders.pose/weight_delta": 3.120894432067871,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10196934640407562,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968076705932617,
      "model/modality_embedder/grad_frac": 0.07934549450874329,
      "model/modality_embedder/grad_norm": 0.026450395584106445,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5293949771689498,
      "model/modality_embedder/update_ratio": 0.0008541181450709701,
      "model/modality_embedder/weight_delta": 3.120894432067871,
      "model/modality_embedder/weight_delta_rel": 0.10196934640407562,
      "model/modality_embedder/weight_norm": 30.968076705932617,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.83517456054688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.191272847522846,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.062605857849121,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.624469183082386,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08131413161754608,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02710665389895439,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009701630915515125,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6499428749084473,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09656551480293274,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.940305709838867,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.77127075195312,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.176046176046174,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.306694030761719,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.301214634036775,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.082118459045887,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.027374783530831337,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009205419337376952,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.360205888748169,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11640015989542007,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.737682342529297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.64669799804688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.00158329324996,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.195146560668945,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.55574083192698,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0807512179017067,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.026919003576040268,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008766558021306992,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6349236965179443,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12205392867326736,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.70646858215332,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.41666412353516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.717760441718774,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.55177116394043,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.735113835458353,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09845336526632309,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.032820142805576324,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001096644438803196,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.117839813232422,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10655296593904495,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.92778968811035,
      "model/normalizer/grad_frac": 0.40222275257110596,
      "model/normalizer/grad_norm": 0.13408386707305908,
      "model/normalizer/grad_zero_frac": 0.00021271291188895702,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017054546624422073,
      "model/normalizer/weight_delta": 6.571832656860352,
      "model/normalizer/weight_delta_rel": 0.08464139699935913,
      "model/normalizer/weight_norm": 78.62059783935547,
      "pose_mae_dtheta": 0.05093112215399742,
      "pose_mae_dx": 0.016983939334750175,
      "pose_mae_dy": 0.022281164303421974,
      "pose_rmse_dtheta": 0.13248775899410248,
      "pose_rmse_dx": 0.04833361506462097,
      "pose_rmse_dy": 0.061913520097732544,
      "pose_rmse_mean": 0.08091163635253906,
      "rmse_dtheta": 0.01705487072467804,
      "rmse_dx": 0.004065761808305979,
      "rmse_dy": 0.005106060765683651,
      "rmse_mean": 0.00874223094433546,
      "rotation_flip": 0.0023923444095999002,
      "sparse_tokens": 32073.0,
      "step": 8625,
      "turn_loss": 0.0621308796107769,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.4007619401598216,
      "grad_norm": 0.4619982838630676,
      "learning_rate": 1.8626549630957397e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.029342086985707283,
      "mae_dx": 0.006421995349228382,
      "mae_dy": 0.004654609132558107,
      "pose_mae_dtheta": 0.20937660336494446,
      "pose_mae_dx": 0.061731260269880295,
      "pose_mae_dy": 0.057640861719846725,
      "pose_rmse_dtheta": 0.3946085274219513,
      "pose_rmse_dx": 0.1535654366016388,
      "pose_rmse_dy": 0.11649700254201889,
      "pose_rmse_mean": 0.22155699133872986,
      "rmse_dtheta": 0.04577933996915817,
      "rmse_dx": 0.015629449859261513,
      "rmse_dy": 0.008899268694221973,
      "rmse_mean": 0.02343602105975151,
      "rotation_flip": 0.009333333000540733,
      "sparse_tokens": 12774.0,
      "step": 8626,
      "turn_loss": 0.22973869740962982,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 14943.0,
      "epoch": 0.40080839992566436,
      "grad_norm": 0.660086989402771,
      "learning_rate": 1.8616255380685965e-06,
      "loss": 0.1513,
      "mae_dtheta": 0.03668659180402756,
      "mae_dx": 0.01284556183964014,
      "mae_dy": 0.0068389540538191795,
      "pose_mae_dtheta": 0.2641739547252655,
      "pose_mae_dx": 0.09418945014476776,
      "pose_mae_dy": 0.0740494579076767,
      "pose_rmse_dtheta": 0.4454101026058197,
      "pose_rmse_dx": 0.19071774184703827,
      "pose_rmse_dy": 0.16781184077262878,
      "pose_rmse_mean": 0.2679799199104309,
      "rmse_dtheta": 0.053449321538209915,
      "rmse_dx": 0.02449224144220352,
      "rmse_dy": 0.013578513637185097,
      "rmse_mean": 0.030506692826747894,
      "rotation_flip": 0.031988874077796936,
      "sparse_tokens": 11832.0,
      "step": 8627,
      "turn_loss": 0.27759143710136414,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 35255.0,
      "epoch": 0.40085485969150714,
      "grad_norm": 0.6495180726051331,
      "learning_rate": 1.8605963325096621e-06,
      "loss": 0.1413,
      "mae_dtheta": 0.030817780643701553,
      "mae_dx": 0.013108405284583569,
      "mae_dy": 0.004589943680912256,
      "pose_mae_dtheta": 0.2527388334274292,
      "pose_mae_dx": 0.11862456798553467,
      "pose_mae_dy": 0.05752784013748169,
      "pose_rmse_dtheta": 0.4727884531021118,
      "pose_rmse_dx": 0.27167704701423645,
      "pose_rmse_dy": 0.15475741028785706,
      "pose_rmse_mean": 0.2997409701347351,
      "rmse_dtheta": 0.0486418791115284,
      "rmse_dx": 0.026429008692502975,
      "rmse_dy": 0.011436481960117817,
      "rmse_mean": 0.02883579209446907,
      "rotation_flip": 0.010400000028312206,
      "sparse_tokens": 25660.0,
      "step": 8628,
      "turn_loss": 0.24896976351737976,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.4009013194573499,
      "grad_norm": 0.5008471608161926,
      "learning_rate": 1.859567346490913e-06,
      "loss": 0.1154,
      "mae_dtheta": 0.03406762704253197,
      "mae_dx": 0.01307764369994402,
      "mae_dy": 0.006234905682504177,
      "pose_mae_dtheta": 0.22725537419319153,
      "pose_mae_dx": 0.10559336841106415,
      "pose_mae_dy": 0.07751602679491043,
      "pose_rmse_dtheta": 0.4186687469482422,
      "pose_rmse_dx": 0.24820061028003693,
      "pose_rmse_dy": 0.1688094288110733,
      "pose_rmse_mean": 0.2785595953464508,
      "rmse_dtheta": 0.05098821222782135,
      "rmse_dx": 0.026539577171206474,
      "rmse_dy": 0.012287335470318794,
      "rmse_mean": 0.02993837557733059,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 14487.0,
      "step": 8629,
      "turn_loss": 0.3118197023868561,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.4009477792231927,
      "grad_norm": 0.48239845037460327,
      "learning_rate": 1.8585385800843031e-06,
      "loss": 0.1098,
      "mae_dtheta": 0.03292971849441528,
      "mae_dx": 0.007840881124138832,
      "mae_dy": 0.0062364861369132996,
      "pose_mae_dtheta": 0.22421857714653015,
      "pose_mae_dx": 0.07104901224374771,
      "pose_mae_dy": 0.07972757518291473,
      "pose_rmse_dtheta": 0.46372267603874207,
      "pose_rmse_dx": 0.18458689749240875,
      "pose_rmse_dy": 0.21331940591335297,
      "pose_rmse_mean": 0.287209689617157,
      "rmse_dtheta": 0.05230078473687172,
      "rmse_dx": 0.019320808351039886,
      "rmse_dy": 0.014915497973561287,
      "rmse_mean": 0.02884569764137268,
      "rotation_flip": 0.013404825702309608,
      "sparse_tokens": 6683.0,
      "step": 8630,
      "turn_loss": 0.20292671024799347,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4009942389890355,
      "grad_norm": 0.48533040285110474,
      "learning_rate": 1.8575100333617784e-06,
      "loss": 0.0841,
      "mae_dtheta": 0.008450415916740894,
      "mae_dx": 0.0012955995043739676,
      "mae_dy": 0.001393117941915989,
      "pose_mae_dtheta": 0.057190630584955215,
      "pose_mae_dx": 0.01544872485101223,
      "pose_mae_dy": 0.016959965229034424,
      "pose_rmse_dtheta": 0.17924916744232178,
      "pose_rmse_dx": 0.0470820851624012,
      "pose_rmse_dy": 0.04977839067578316,
      "pose_rmse_mean": 0.09203654527664185,
      "rmse_dtheta": 0.02317753992974758,
      "rmse_dx": 0.004531161859631538,
      "rmse_dy": 0.003837574040517211,
      "rmse_mean": 0.010515425354242325,
      "rotation_flip": 0.0019342360319569707,
      "sparse_tokens": 32073.0,
      "step": 8631,
      "turn_loss": 0.06847187131643295,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.4010406987548783,
      "grad_norm": 0.9437406659126282,
      "learning_rate": 1.8564817063952616e-06,
      "loss": 0.265,
      "mae_dtheta": 0.025206387042999268,
      "mae_dx": 0.009466242045164108,
      "mae_dy": 0.004336347337812185,
      "pose_mae_dtheta": 0.19587497413158417,
      "pose_mae_dx": 0.05211463198065758,
      "pose_mae_dy": 0.040396302938461304,
      "pose_rmse_dtheta": 0.31526505947113037,
      "pose_rmse_dx": 0.11347759515047073,
      "pose_rmse_dy": 0.12345340847969055,
      "pose_rmse_mean": 0.1840653419494629,
      "rmse_dtheta": 0.03730221465229988,
      "rmse_dx": 0.020792044699192047,
      "rmse_dy": 0.00782324280589819,
      "rmse_mean": 0.021972499787807465,
      "rotation_flip": 0.009900989942252636,
      "sparse_tokens": 4142.0,
      "step": 8632,
      "turn_loss": 0.24688538908958435,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.4010871585207211,
      "grad_norm": 0.5428458452224731,
      "learning_rate": 1.8554535992566685e-06,
      "loss": 0.136,
      "mae_dtheta": 0.050415586680173874,
      "mae_dx": 0.01185169443488121,
      "mae_dy": 0.009115124121308327,
      "pose_mae_dtheta": 0.38780349493026733,
      "pose_mae_dx": 0.09555276483297348,
      "pose_mae_dy": 0.08360794931650162,
      "pose_rmse_dtheta": 0.6644683480262756,
      "pose_rmse_dx": 0.2139037847518921,
      "pose_rmse_dy": 0.1816123127937317,
      "pose_rmse_mean": 0.3533281683921814,
      "rmse_dtheta": 0.07088403403759003,
      "rmse_dx": 0.023604733869433403,
      "rmse_dy": 0.01860964111983776,
      "rmse_mean": 0.03769947215914726,
      "rotation_flip": 0.015384615398943424,
      "sparse_tokens": 15291.0,
      "step": 8633,
      "turn_loss": 0.4341478645801544,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40113361828656385,
      "grad_norm": 0.3416897654533386,
      "learning_rate": 1.8544257120178911e-06,
      "loss": 0.0672,
      "mae_dtheta": 0.0076837921515107155,
      "mae_dx": 0.001408579759299755,
      "mae_dy": 0.000712995883077383,
      "pose_mae_dtheta": 0.053558409214019775,
      "pose_mae_dx": 0.011844692751765251,
      "pose_mae_dy": 0.010982274077832699,
      "pose_rmse_dtheta": 0.21401920914649963,
      "pose_rmse_dx": 0.031477078795433044,
      "pose_rmse_dy": 0.03271995112299919,
      "pose_rmse_mean": 0.09273874759674072,
      "rmse_dtheta": 0.025986116379499435,
      "rmse_dx": 0.004884310532361269,
      "rmse_dy": 0.0016799805453047156,
      "rmse_mean": 0.010850135236978531,
      "rotation_flip": 0.0029411765281111,
      "sparse_tokens": 32105.0,
      "step": 8634,
      "turn_loss": 0.054724037647247314,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.40118007805240663,
      "grad_norm": 0.33923622965812683,
      "learning_rate": 1.8533980447508138e-06,
      "loss": 0.0867,
      "mae_dtheta": 0.009021595120429993,
      "mae_dx": 0.001591803738847375,
      "mae_dy": 0.0021449888590723276,
      "pose_mae_dtheta": 0.06213384121656418,
      "pose_mae_dx": 0.0165244247764349,
      "pose_mae_dy": 0.019425705075263977,
      "pose_rmse_dtheta": 0.19710443913936615,
      "pose_rmse_dx": 0.0513702929019928,
      "pose_rmse_dy": 0.04841156676411629,
      "pose_rmse_mean": 0.09896209836006165,
      "rmse_dtheta": 0.022976525127887726,
      "rmse_dx": 0.0048583257012069225,
      "rmse_dy": 0.005934073589742184,
      "rmse_mean": 0.011256309226155281,
      "rotation_flip": 0.007939659059047699,
      "sparse_tokens": 32121.0,
      "step": 8635,
      "turn_loss": 0.07628393918275833,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4012265378182494,
      "grad_norm": 0.41887786984443665,
      "learning_rate": 1.8523705975272981e-06,
      "loss": 0.0871,
      "mae_dtheta": 0.006170297507196665,
      "mae_dx": 0.0020732437260448933,
      "mae_dy": 0.0016699585830792785,
      "pose_mae_dtheta": 0.04350460693240166,
      "pose_mae_dx": 0.017919307574629784,
      "pose_mae_dy": 0.015587992034852505,
      "pose_rmse_dtheta": 0.1181141585111618,
      "pose_rmse_dx": 0.04488742724061012,
      "pose_rmse_dy": 0.041875358670949936,
      "pose_rmse_mean": 0.06829231977462769,
      "rmse_dtheta": 0.017611373215913773,
      "rmse_dx": 0.006661768537014723,
      "rmse_dy": 0.005694429390132427,
      "rmse_mean": 0.009989190846681595,
      "rotation_flip": 0.003678402630612254,
      "sparse_tokens": 32105.0,
      "step": 8636,
      "turn_loss": 0.07900689542293549,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.4012729975840922,
      "grad_norm": 0.6360358595848083,
      "learning_rate": 1.851343370419198e-06,
      "loss": 0.1319,
      "mae_dtheta": 0.010757416486740112,
      "mae_dx": 0.0018356465734541416,
      "mae_dy": 0.002489567967131734,
      "pose_mae_dtheta": 0.07303415983915329,
      "pose_mae_dx": 0.026238709688186646,
      "pose_mae_dy": 0.03085487149655819,
      "pose_rmse_dtheta": 0.19393397867679596,
      "pose_rmse_dx": 0.07435127347707748,
      "pose_rmse_dy": 0.07870756089687347,
      "pose_rmse_mean": 0.11566426604986191,
      "rmse_dtheta": 0.025494802743196487,
      "rmse_dx": 0.005557248834520578,
      "rmse_dy": 0.00560477701947093,
      "rmse_mean": 0.012218942865729332,
      "rotation_flip": 0.0070290532894432545,
      "sparse_tokens": 32025.0,
      "step": 8637,
      "turn_loss": 0.09092070907354355,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.40131945734993496,
      "grad_norm": 0.42812782526016235,
      "learning_rate": 1.850316363498344e-06,
      "loss": 0.1499,
      "mae_dtheta": 0.012713094241917133,
      "mae_dx": 0.002202017931267619,
      "mae_dy": 0.0035193453077226877,
      "pose_mae_dtheta": 0.0858907625079155,
      "pose_mae_dx": 0.02803269401192665,
      "pose_mae_dy": 0.04132234305143356,
      "pose_rmse_dtheta": 0.18829190731048584,
      "pose_rmse_dx": 0.06763704121112823,
      "pose_rmse_dy": 0.10674215853214264,
      "pose_rmse_mean": 0.12089036405086517,
      "rmse_dtheta": 0.02588440105319023,
      "rmse_dx": 0.007497092708945274,
      "rmse_dy": 0.007933839224278927,
      "rmse_mean": 0.013771777972579002,
      "rotation_flip": 0.007700385060161352,
      "sparse_tokens": 32089.0,
      "step": 8638,
      "turn_loss": 0.1252557635307312,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.40136591711577774,
      "grad_norm": 0.6124580502510071,
      "learning_rate": 1.8492895768365593e-06,
      "loss": 0.1476,
      "mae_dtheta": 0.018961623311042786,
      "mae_dx": 0.004649041220545769,
      "mae_dy": 0.0060002305544912815,
      "pose_mae_dtheta": 0.1345365196466446,
      "pose_mae_dx": 0.05370434746146202,
      "pose_mae_dy": 0.06888829916715622,
      "pose_rmse_dtheta": 0.24753284454345703,
      "pose_rmse_dx": 0.1237073615193367,
      "pose_rmse_dy": 0.147745281457901,
      "pose_rmse_mean": 0.1729951798915863,
      "rmse_dtheta": 0.030987676233053207,
      "rmse_dx": 0.012649635784327984,
      "rmse_dy": 0.012574571184813976,
      "rmse_mean": 0.018737295642495155,
      "rotation_flip": 0.005065554287284613,
      "sparse_tokens": 32057.0,
      "step": 8639,
      "turn_loss": 0.22293546795845032,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.4014123768816205,
      "grad_norm": 0.5449918508529663,
      "learning_rate": 1.8482630105056438e-06,
      "loss": 0.0972,
      "mae_dtheta": 0.024614660069346428,
      "mae_dx": 0.009127088822424412,
      "mae_dy": 0.002735433867201209,
      "pose_mae_dtheta": 0.15988120436668396,
      "pose_mae_dx": 0.07240720838308334,
      "pose_mae_dy": 0.02799144573509693,
      "pose_rmse_dtheta": 0.30376875400543213,
      "pose_rmse_dx": 0.23944920301437378,
      "pose_rmse_dy": 0.06090257316827774,
      "pose_rmse_mean": 0.20137351751327515,
      "rmse_dtheta": 0.04159090667963028,
      "rmse_dx": 0.023827482014894485,
      "rmse_dy": 0.005482882726937532,
      "rmse_mean": 0.02363375946879387,
      "rotation_flip": 0.024561403319239616,
      "sparse_tokens": 4788.0,
      "step": 8640,
      "turn_loss": 0.18953336775302887,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4014588366474633,
      "grad_norm": 0.5145488381385803,
      "learning_rate": 1.8472366645773892e-06,
      "loss": 0.1375,
      "mae_dtheta": 0.007405972573906183,
      "mae_dx": 0.000993566820397973,
      "mae_dy": 0.0010694462107494473,
      "pose_mae_dtheta": 0.048490751534700394,
      "pose_mae_dx": 0.010644139721989632,
      "pose_mae_dy": 0.015444399788975716,
      "pose_rmse_dtheta": 0.16953474283218384,
      "pose_rmse_dx": 0.028468143194913864,
      "pose_rmse_dy": 0.04006284847855568,
      "pose_rmse_mean": 0.07935524731874466,
      "rmse_dtheta": 0.019608983770012856,
      "rmse_dx": 0.0033027855679392815,
      "rmse_dy": 0.002370197093114257,
      "rmse_mean": 0.008427321910858154,
      "rotation_flip": 0.008072175085544586,
      "sparse_tokens": 32105.0,
      "step": 8641,
      "turn_loss": 0.05223475396633148,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.40150529641330607,
      "grad_norm": 0.4068986475467682,
      "learning_rate": 1.8462105391235652e-06,
      "loss": 0.0871,
      "mae_dtheta": 0.02958228997886181,
      "mae_dx": 0.013268650509417057,
      "mae_dy": 0.00714783975854516,
      "pose_mae_dtheta": 0.22894451022148132,
      "pose_mae_dx": 0.10338901728391647,
      "pose_mae_dy": 0.1048220694065094,
      "pose_rmse_dtheta": 0.40391838550567627,
      "pose_rmse_dx": 0.20535492897033691,
      "pose_rmse_dy": 0.2261393517255783,
      "pose_rmse_mean": 0.278470903635025,
      "rmse_dtheta": 0.04410148784518242,
      "rmse_dx": 0.026357417926192284,
      "rmse_dy": 0.013121594674885273,
      "rmse_mean": 0.027860168367624283,
      "rotation_flip": 0.02505219168961048,
      "sparse_tokens": 8049.0,
      "step": 8642,
      "turn_loss": 0.2838345766067505,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 28139.0,
      "epoch": 0.40155175617914884,
      "grad_norm": 0.41069793701171875,
      "learning_rate": 1.8451846342159308e-06,
      "loss": 0.109,
      "mae_dtheta": 0.02832864597439766,
      "mae_dx": 0.010952409356832504,
      "mae_dy": 0.004919618368148804,
      "pose_mae_dtheta": 0.2367199957370758,
      "pose_mae_dx": 0.08978748321533203,
      "pose_mae_dy": 0.06390706449747086,
      "pose_rmse_dtheta": 0.439910352230072,
      "pose_rmse_dx": 0.21912585198879242,
      "pose_rmse_dy": 0.14390169084072113,
      "pose_rmse_mean": 0.2676459848880768,
      "rmse_dtheta": 0.04624953493475914,
      "rmse_dx": 0.02421305701136589,
      "rmse_dy": 0.009653025306761265,
      "rmse_mean": 0.02670520544052124,
      "rotation_flip": 0.009842519648373127,
      "sparse_tokens": 21941.0,
      "step": 8643,
      "turn_loss": 0.2397129088640213,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4015982159449916,
      "grad_norm": 0.2425420880317688,
      "learning_rate": 1.8441589499262302e-06,
      "loss": 0.066,
      "mae_dtheta": 0.009168633259832859,
      "mae_dx": 0.0019144342513754964,
      "mae_dy": 0.0023685733322054148,
      "pose_mae_dtheta": 0.06328848004341125,
      "pose_mae_dx": 0.018009087070822716,
      "pose_mae_dy": 0.024282965809106827,
      "pose_rmse_dtheta": 0.17206044495105743,
      "pose_rmse_dx": 0.05048051103949547,
      "pose_rmse_dy": 0.062118858098983765,
      "pose_rmse_mean": 0.09488660097122192,
      "rmse_dtheta": 0.022022563964128494,
      "rmse_dx": 0.007808311376720667,
      "rmse_dy": 0.007147032301872969,
      "rmse_mean": 0.012325968593358994,
      "rotation_flip": 0.003546099178493023,
      "sparse_tokens": 32105.0,
      "step": 8644,
      "turn_loss": 0.07813563942909241,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4016446757108344,
      "grad_norm": 0.43492820858955383,
      "learning_rate": 1.8431334863261857e-06,
      "loss": 0.0886,
      "mae_dtheta": 0.013515973463654518,
      "mae_dx": 0.0022266956511884928,
      "mae_dy": 0.002959309844300151,
      "pose_mae_dtheta": 0.09106108546257019,
      "pose_mae_dx": 0.026920320466160774,
      "pose_mae_dy": 0.03518586605787277,
      "pose_rmse_dtheta": 0.22028285264968872,
      "pose_rmse_dx": 0.07235608994960785,
      "pose_rmse_dy": 0.08362140506505966,
      "pose_rmse_mean": 0.12542012333869934,
      "rmse_dtheta": 0.029063859954476357,
      "rmse_dx": 0.00726821506395936,
      "rmse_dy": 0.006835107691586018,
      "rmse_mean": 0.01438906043767929,
      "rotation_flip": 0.006326758302748203,
      "sparse_tokens": 32105.0,
      "step": 8645,
      "turn_loss": 0.12230034917593002,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4016911354766772,
      "grad_norm": 0.4390566349029541,
      "learning_rate": 1.8421082434875133e-06,
      "loss": 0.0838,
      "mae_dtheta": 0.008409588597714901,
      "mae_dx": 0.0012007307959720492,
      "mae_dy": 0.0014660117449238896,
      "pose_mae_dtheta": 0.05853818729519844,
      "pose_mae_dx": 0.01776645891368389,
      "pose_mae_dy": 0.024850130081176758,
      "pose_rmse_dtheta": 0.17559844255447388,
      "pose_rmse_dx": 0.0472029484808445,
      "pose_rmse_dy": 0.08255729079246521,
      "pose_rmse_mean": 0.10178622603416443,
      "rmse_dtheta": 0.02123396471142769,
      "rmse_dx": 0.003380062524229288,
      "rmse_dy": 0.0036175972782075405,
      "rmse_mean": 0.009410541504621506,
      "rotation_flip": 0.008302583359181881,
      "sparse_tokens": 32121.0,
      "step": 8646,
      "turn_loss": 0.05981544405221939,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40173759524251995,
      "grad_norm": 0.30264902114868164,
      "learning_rate": 1.8410832214819046e-06,
      "loss": 0.0771,
      "mae_dtheta": 0.011060398072004318,
      "mae_dx": 0.002213264349848032,
      "mae_dy": 0.002695895731449127,
      "pose_mae_dtheta": 0.0667014792561531,
      "pose_mae_dx": 0.02670872211456299,
      "pose_mae_dy": 0.03176072612404823,
      "pose_rmse_dtheta": 0.1430642455816269,
      "pose_rmse_dx": 0.0680428296327591,
      "pose_rmse_dy": 0.06567448377609253,
      "pose_rmse_mean": 0.09226052463054657,
      "rmse_dtheta": 0.021801110357046127,
      "rmse_dx": 0.007215899880975485,
      "rmse_dy": 0.005995204672217369,
      "rmse_mean": 0.011670738458633423,
      "rotation_flip": 0.012302960269153118,
      "sparse_tokens": 32105.0,
      "step": 8647,
      "turn_loss": 0.10598943382501602,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.4017840550083628,
      "grad_norm": 0.5051611661911011,
      "learning_rate": 1.8400584203810434e-06,
      "loss": 0.1454,
      "mae_dtheta": 0.04100177064538002,
      "mae_dx": 0.013783263973891735,
      "mae_dy": 0.007629529573023319,
      "pose_mae_dtheta": 0.3328342139720917,
      "pose_mae_dx": 0.09835467487573624,
      "pose_mae_dy": 0.0725170448422432,
      "pose_rmse_dtheta": 0.5976245403289795,
      "pose_rmse_dx": 0.2034604847431183,
      "pose_rmse_dy": 0.21424607932567596,
      "pose_rmse_mean": 0.33844369649887085,
      "rmse_dtheta": 0.06304804980754852,
      "rmse_dx": 0.0249326191842556,
      "rmse_dy": 0.018576638773083687,
      "rmse_mean": 0.035519104450941086,
      "rotation_flip": 0.01284403633326292,
      "sparse_tokens": 9229.0,
      "step": 8648,
      "turn_loss": 0.29373735189437866,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.40183051477420556,
      "grad_norm": 0.34321320056915283,
      "learning_rate": 1.839033840256591e-06,
      "loss": 0.0718,
      "mae_dtheta": 0.006005134433507919,
      "mae_dx": 0.000978441210463643,
      "mae_dy": 0.0009951035026460886,
      "pose_mae_dtheta": 0.03972112014889717,
      "pose_mae_dx": 0.010368509218096733,
      "pose_mae_dy": 0.012329095043241978,
      "pose_rmse_dtheta": 0.15088140964508057,
      "pose_rmse_dx": 0.028782499954104424,
      "pose_rmse_dy": 0.04661768674850464,
      "pose_rmse_mean": 0.07542720437049866,
      "rmse_dtheta": 0.017582984641194344,
      "rmse_dx": 0.0027586636133491993,
      "rmse_dy": 0.0027453608345240355,
      "rmse_mean": 0.007695669308304787,
      "rotation_flip": 0.005004549399018288,
      "sparse_tokens": 32153.0,
      "step": 8649,
      "turn_loss": 0.04124639555811882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.40187697454004834,
      "grad_norm": 0.48749157786369324,
      "learning_rate": 1.8380094811801984e-06,
      "loss": 0.1083,
      "mae_dtheta": 0.008021683432161808,
      "mae_dx": 0.0011760024353861809,
      "mae_dy": 0.0007391332183033228,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4874916672706604,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.56240844726562,
      "model/head/act_norm_mean": 125.86776949179293,
      "model/head/act_norm_min": 64.39376068115234,
      "model/head/act_over_embed": 86.49750958738396,
      "model/head/grad_frac": 0.08686687052249908,
      "model/head/grad_norm": 0.04234687611460686,
      "model/head/grad_zero_frac": 0.0002087648317683488,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6957514599116161,
      "model/head/update_ratio": 0.0007212364580482244,
      "model/head/weight_delta": 9.805931091308594,
      "model/head/weight_delta_rel": 0.17202506959438324,
      "model/head/weight_norm": 58.71427536010742,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42245423793792725,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42237405408605483,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42230910062789917,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2902594042961327,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0745375007390976,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03633641079068184,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5425747719957081,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011733508436009288,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1198902130126953,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10193653404712677,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96807098388672,
      "model/modality_embedder/grad_frac": 0.0745375007390976,
      "model/modality_embedder/grad_norm": 0.03633641079068184,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5425747719957081,
      "model/modality_embedder/update_ratio": 0.0011733508436009288,
      "model/modality_embedder/weight_delta": 3.1198902130126953,
      "model/modality_embedder/weight_delta_rel": 0.10193653404712677,
      "model/modality_embedder/weight_norm": 30.96807098388672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.06078338623047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.17655723905724,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.065689086914062,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.301565841322624,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.057063184678554535,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.027817826718091965,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00033287605037912726,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009956042049452662,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6519546508789062,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09663882851600647,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.94064712524414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.20375061035156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.1996151996152,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.404901504516602,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.004620849837586,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05738678574562073,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.027975579723715782,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009407264296896756,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3625214099884033,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11648037284612656,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.73827362060547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.81249237060547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.042994428411095,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.290642738342285,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.27140831385437,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.059406254440546036,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.028960054740309715,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009431031649000943,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6375184059143066,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12214105576276779,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.707197189331055,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.33441925048828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.681139269680937,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.068599700927734,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.39715678532864,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05275765433907509,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.025718916207551956,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008593524689786136,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.120346784591675,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10663864761590958,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.928251266479492,
      "model/normalizer/grad_frac": 0.20463159680366516,
      "model/normalizer/grad_norm": 0.09975619614124298,
      "model/normalizer/grad_zero_frac": 0.00025880071916617453,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0012688174610957503,
      "model/normalizer/weight_delta": 6.576714038848877,
      "model/normalizer/weight_delta_rel": 0.08470427244901657,
      "model/normalizer/weight_norm": 78.62139129638672,
      "pose_mae_dtheta": 0.05498030036687851,
      "pose_mae_dx": 0.010526546277105808,
      "pose_mae_dy": 0.009795008227229118,
      "pose_rmse_dtheta": 0.22793163359165192,
      "pose_rmse_dx": 0.03477250039577484,
      "pose_rmse_dy": 0.03749195858836174,
      "pose_rmse_mean": 0.10006536543369293,
      "rmse_dtheta": 0.026882115751504898,
      "rmse_dx": 0.003782600397244096,
      "rmse_dy": 0.0023571972269564867,
      "rmse_mean": 0.011007304303348064,
      "rotation_flip": 0.002124269725754857,
      "sparse_tokens": 32185.0,
      "step": 8650,
      "turn_loss": 0.050883058458566666,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.4019234343058911,
      "grad_norm": 0.3905610144138336,
      "learning_rate": 1.8369853432235024e-06,
      "loss": 0.0852,
      "mae_dtheta": 0.034226663410663605,
      "mae_dx": 0.013645779341459274,
      "mae_dy": 0.003426279639825225,
      "pose_mae_dtheta": 0.2760017216205597,
      "pose_mae_dx": 0.09758565574884415,
      "pose_mae_dy": 0.036457739770412445,
      "pose_rmse_dtheta": 0.5107181668281555,
      "pose_rmse_dx": 0.19568102061748505,
      "pose_rmse_dy": 0.07932407408952713,
      "pose_rmse_mean": 0.26190775632858276,
      "rmse_dtheta": 0.0536847859621048,
      "rmse_dx": 0.02522132359445095,
      "rmse_dy": 0.006845153868198395,
      "rmse_mean": 0.02858375571668148,
      "rotation_flip": 0.0154440151527524,
      "sparse_tokens": 7765.0,
      "step": 8651,
      "turn_loss": 0.2531760632991791,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.4019698940717339,
      "grad_norm": 0.36265870928764343,
      "learning_rate": 1.835961426458117e-06,
      "loss": 0.0693,
      "mae_dtheta": 0.03579277917742729,
      "mae_dx": 0.007824983447790146,
      "mae_dy": 0.0045765843242406845,
      "pose_mae_dtheta": 0.3071303367614746,
      "pose_mae_dx": 0.05122644454240799,
      "pose_mae_dy": 0.04610748216509819,
      "pose_rmse_dtheta": 0.5342730283737183,
      "pose_rmse_dx": 0.0979493260383606,
      "pose_rmse_dy": 0.12539313733577728,
      "pose_rmse_mean": 0.2525385022163391,
      "rmse_dtheta": 0.05547221004962921,
      "rmse_dx": 0.016043325886130333,
      "rmse_dy": 0.012994812801480293,
      "rmse_mean": 0.028170116245746613,
      "rotation_flip": 0.006779660936444998,
      "sparse_tokens": 5433.0,
      "step": 8652,
      "turn_loss": 0.2149583399295807,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40201635383757667,
      "grad_norm": 0.44397109746932983,
      "learning_rate": 1.8349377309556487e-06,
      "loss": 0.0999,
      "mae_dtheta": 0.00990154780447483,
      "mae_dx": 0.0010570100275799632,
      "mae_dy": 0.0020458686631172895,
      "pose_mae_dtheta": 0.05685162916779518,
      "pose_mae_dx": 0.017023345455527306,
      "pose_mae_dy": 0.024693138897418976,
      "pose_rmse_dtheta": 0.1378880888223648,
      "pose_rmse_dx": 0.03860454261302948,
      "pose_rmse_dy": 0.052313029766082764,
      "pose_rmse_mean": 0.07626855373382568,
      "rmse_dtheta": 0.022739451378583908,
      "rmse_dx": 0.0027193850837647915,
      "rmse_dy": 0.004257411230355501,
      "rmse_mean": 0.009905416518449783,
      "rotation_flip": 0.010383100248873234,
      "sparse_tokens": 32105.0,
      "step": 8653,
      "turn_loss": 0.07701998203992844,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.40206281360341944,
      "grad_norm": 0.787021815776825,
      "learning_rate": 1.8339142567876828e-06,
      "loss": 0.147,
      "mae_dtheta": 0.029083918780088425,
      "mae_dx": 0.010564686730504036,
      "mae_dy": 0.0031863402109593153,
      "pose_mae_dtheta": 0.21129776537418365,
      "pose_mae_dx": 0.08544708788394928,
      "pose_mae_dy": 0.03935179114341736,
      "pose_rmse_dtheta": 0.3997845947742462,
      "pose_rmse_dx": 0.19352629780769348,
      "pose_rmse_dy": 0.09986009448766708,
      "pose_rmse_mean": 0.23105698823928833,
      "rmse_dtheta": 0.04660319909453392,
      "rmse_dx": 0.022257372736930847,
      "rmse_dy": 0.0071917129680514336,
      "rmse_mean": 0.02535076253116131,
      "rotation_flip": 0.0031595577020198107,
      "sparse_tokens": 11295.0,
      "step": 8654,
      "turn_loss": 0.19111919403076172,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.4021092733692622,
      "grad_norm": 1.7332382202148438,
      "learning_rate": 1.8328910040257913e-06,
      "loss": 0.3126,
      "mae_dtheta": 0.03224446624517441,
      "mae_dx": 0.02182810567319393,
      "mae_dy": 0.013125921599566936,
      "pose_mae_dtheta": 0.19564189016819,
      "pose_mae_dx": 0.15392819046974182,
      "pose_mae_dy": 0.1592470407485962,
      "pose_rmse_dtheta": 0.28604328632354736,
      "pose_rmse_dx": 0.31686070561408997,
      "pose_rmse_dy": 0.25535014271736145,
      "pose_rmse_mean": 0.28608471155166626,
      "rmse_dtheta": 0.04418383166193962,
      "rmse_dx": 0.03583770617842674,
      "rmse_dy": 0.02152351103723049,
      "rmse_mean": 0.0338483527302742,
      "rotation_flip": 0.01224489789456129,
      "sparse_tokens": 4082.0,
      "step": 8655,
      "turn_loss": 0.3179594576358795,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.402155733135105,
      "grad_norm": 0.5360174775123596,
      "learning_rate": 1.831867972741534e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.009988870471715927,
      "mae_dx": 0.0019297891994938254,
      "mae_dy": 0.002980343531817198,
      "pose_mae_dtheta": 0.06303762644529343,
      "pose_mae_dx": 0.026102418079972267,
      "pose_mae_dy": 0.028580637648701668,
      "pose_rmse_dtheta": 0.1597299426794052,
      "pose_rmse_dx": 0.06425409764051437,
      "pose_rmse_dy": 0.05669139325618744,
      "pose_rmse_mean": 0.09355847537517548,
      "rmse_dtheta": 0.019503960385918617,
      "rmse_dx": 0.004766965284943581,
      "rmse_dy": 0.005786330439150333,
      "rmse_mean": 0.010019085370004177,
      "rotation_flip": 0.003981623332947493,
      "sparse_tokens": 32121.0,
      "step": 8656,
      "turn_loss": 0.09215659648180008,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4022021929009478,
      "grad_norm": 1.079871416091919,
      "learning_rate": 1.8308451630064484e-06,
      "loss": 0.1374,
      "mae_dtheta": 0.007990673184394836,
      "mae_dx": 0.001500575104728341,
      "mae_dy": 0.001959826797246933,
      "pose_mae_dtheta": 0.05162869766354561,
      "pose_mae_dx": 0.017385736107826233,
      "pose_mae_dy": 0.020773090422153473,
      "pose_rmse_dtheta": 0.13266998529434204,
      "pose_rmse_dx": 0.04727499559521675,
      "pose_rmse_dy": 0.05605261027812958,
      "pose_rmse_mean": 0.07866586744785309,
      "rmse_dtheta": 0.019509539008140564,
      "rmse_dx": 0.004218138288706541,
      "rmse_dy": 0.004434880800545216,
      "rmse_mean": 0.009387519210577011,
      "rotation_flip": 0.008168027736246586,
      "sparse_tokens": 32121.0,
      "step": 8657,
      "turn_loss": 0.07447275519371033,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40224865266679055,
      "grad_norm": 0.5080896019935608,
      "learning_rate": 1.8298225748920629e-06,
      "loss": 0.1361,
      "mae_dtheta": 0.011548478156328201,
      "mae_dx": 0.001630178652703762,
      "mae_dy": 0.0026793687138706446,
      "pose_mae_dtheta": 0.07588066160678864,
      "pose_mae_dx": 0.024611543864011765,
      "pose_mae_dy": 0.03134207800030708,
      "pose_rmse_dtheta": 0.18248914182186127,
      "pose_rmse_dx": 0.05805850774049759,
      "pose_rmse_dy": 0.06690531224012375,
      "pose_rmse_mean": 0.102484330534935,
      "rmse_dtheta": 0.02287767454981804,
      "rmse_dx": 0.004519662819802761,
      "rmse_dy": 0.005151166580617428,
      "rmse_mean": 0.010849501937627792,
      "rotation_flip": 0.0022505626548081636,
      "sparse_tokens": 32105.0,
      "step": 8658,
      "turn_loss": 0.0921705961227417,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.40229511243263333,
      "grad_norm": 0.48994430899620056,
      "learning_rate": 1.8288002084698842e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.008335464634001255,
      "mae_dx": 0.001406564493663609,
      "mae_dy": 0.0013290931237861514,
      "pose_mae_dtheta": 0.05308898910880089,
      "pose_mae_dx": 0.014317890629172325,
      "pose_mae_dy": 0.014776541851460934,
      "pose_rmse_dtheta": 0.1675853431224823,
      "pose_rmse_dx": 0.039696499705314636,
      "pose_rmse_dy": 0.03831798583269119,
      "pose_rmse_mean": 0.08186661452054977,
      "rmse_dtheta": 0.02315370738506317,
      "rmse_dx": 0.004152166191488504,
      "rmse_dy": 0.0034167333506047726,
      "rmse_mean": 0.010240869596600533,
      "rotation_flip": 0.004557885229587555,
      "sparse_tokens": 32137.0,
      "step": 8659,
      "turn_loss": 0.06472908705472946,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4023415721984761,
      "grad_norm": 0.4201775789260864,
      "learning_rate": 1.8277780638114112e-06,
      "loss": 0.0803,
      "mae_dtheta": 0.0055417404510080814,
      "mae_dx": 0.0011799685889855027,
      "mae_dy": 0.00070652348222211,
      "pose_mae_dtheta": 0.03868960589170456,
      "pose_mae_dx": 0.010908132418990135,
      "pose_mae_dy": 0.010522051714360714,
      "pose_rmse_dtheta": 0.13103386759757996,
      "pose_rmse_dx": 0.027861235663294792,
      "pose_rmse_dy": 0.029890278354287148,
      "pose_rmse_mean": 0.0629284679889679,
      "rmse_dtheta": 0.01767210103571415,
      "rmse_dx": 0.003883593250066042,
      "rmse_dy": 0.0015069356886669993,
      "rmse_mean": 0.007687543518841267,
      "rotation_flip": 0.0009174311999231577,
      "sparse_tokens": 32169.0,
      "step": 8660,
      "turn_loss": 0.04551779106259346,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4023880319643189,
      "grad_norm": 0.4260014295578003,
      "learning_rate": 1.826756140988119e-06,
      "loss": 0.0957,
      "mae_dtheta": 0.00736083323135972,
      "mae_dx": 0.0012912721140310168,
      "mae_dy": 0.0019713917281478643,
      "pose_mae_dtheta": 0.05140570551156998,
      "pose_mae_dx": 0.01832396723330021,
      "pose_mae_dy": 0.025895221158862114,
      "pose_rmse_dtheta": 0.11291991919279099,
      "pose_rmse_dx": 0.04934001713991165,
      "pose_rmse_dy": 0.06378880888223648,
      "pose_rmse_mean": 0.0753495842218399,
      "rmse_dtheta": 0.016931699588894844,
      "rmse_dx": 0.0037812653463333845,
      "rmse_dy": 0.004572972189635038,
      "rmse_mean": 0.008428646251559258,
      "rotation_flip": 0.0018957345746457577,
      "sparse_tokens": 32073.0,
      "step": 8661,
      "turn_loss": 0.07053529471158981,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.40243449173016166,
      "grad_norm": 0.3286418914794922,
      "learning_rate": 1.8257344400714732e-06,
      "loss": 0.0641,
      "mae_dtheta": 0.004843997303396463,
      "mae_dx": 0.001015298068523407,
      "mae_dy": 0.0003172239812556654,
      "pose_mae_dtheta": 0.031016793102025986,
      "pose_mae_dx": 0.006873978301882744,
      "pose_mae_dy": 0.0033154545817524195,
      "pose_rmse_dtheta": 0.1627129167318344,
      "pose_rmse_dx": 0.01576191559433937,
      "pose_rmse_dy": 0.008722111582756042,
      "pose_rmse_mean": 0.06239898130297661,
      "rmse_dtheta": 0.021758345887064934,
      "rmse_dx": 0.00304914778098464,
      "rmse_dy": 0.0016912153223529458,
      "rmse_mean": 0.008832903578877449,
      "rotation_flip": 0.0018072288949042559,
      "sparse_tokens": 32201.0,
      "step": 8662,
      "turn_loss": 0.035307470709085464,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24987.0,
      "epoch": 0.40248095149600444,
      "grad_norm": 0.6238707304000854,
      "learning_rate": 1.8247129611329234e-06,
      "loss": 0.1494,
      "mae_dtheta": 0.023163292557001114,
      "mae_dx": 0.011705797165632248,
      "mae_dy": 0.005239032208919525,
      "pose_mae_dtheta": 0.1680765300989151,
      "pose_mae_dx": 0.07771261781454086,
      "pose_mae_dy": 0.039307765662670135,
      "pose_rmse_dtheta": 0.3390278220176697,
      "pose_rmse_dx": 0.17972899973392487,
      "pose_rmse_dy": 0.10123559832572937,
      "pose_rmse_mean": 0.20666413009166718,
      "rmse_dtheta": 0.04039062187075615,
      "rmse_dx": 0.02415423095226288,
      "rmse_dy": 0.012445668689906597,
      "rmse_mean": 0.025663508102297783,
      "rotation_flip": 0.012500000186264515,
      "sparse_tokens": 18950.0,
      "step": 8663,
      "turn_loss": 0.23612436652183533,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.40252741126184727,
      "grad_norm": 1.120093584060669,
      "learning_rate": 1.8236917042438985e-06,
      "loss": 0.2238,
      "mae_dtheta": 0.030912525951862335,
      "mae_dx": 0.012758245691657066,
      "mae_dy": 0.0045420634560287,
      "pose_mae_dtheta": 0.27208542823791504,
      "pose_mae_dx": 0.11306925863027573,
      "pose_mae_dy": 0.06150278076529503,
      "pose_rmse_dtheta": 0.4820634424686432,
      "pose_rmse_dx": 0.2495822012424469,
      "pose_rmse_dy": 0.1453426629304886,
      "pose_rmse_mean": 0.29232943058013916,
      "rmse_dtheta": 0.049363620579242706,
      "rmse_dx": 0.026231244206428528,
      "rmse_dy": 0.008217010647058487,
      "rmse_mean": 0.02793729305267334,
      "rotation_flip": 0.008342023007571697,
      "sparse_tokens": 18864.0,
      "step": 8664,
      "turn_loss": 0.25754764676094055,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.40257387102769004,
      "grad_norm": 0.5620194673538208,
      "learning_rate": 1.8226706694758194e-06,
      "loss": 0.1223,
      "mae_dtheta": 0.012005372904241085,
      "mae_dx": 0.002551873680204153,
      "mae_dy": 0.0029834555462002754,
      "pose_mae_dtheta": 0.08645378798246384,
      "pose_mae_dx": 0.029072945937514305,
      "pose_mae_dy": 0.02958497405052185,
      "pose_rmse_dtheta": 0.24664083123207092,
      "pose_rmse_dx": 0.08001238852739334,
      "pose_rmse_dy": 0.08799368888139725,
      "pose_rmse_mean": 0.13821563124656677,
      "rmse_dtheta": 0.0290818028151989,
      "rmse_dx": 0.007788750343024731,
      "rmse_dy": 0.007929608225822449,
      "rmse_mean": 0.014933387748897076,
      "rotation_flip": 0.01010989025235176,
      "sparse_tokens": 32073.0,
      "step": 8665,
      "turn_loss": 0.10775105655193329,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31466.0,
      "epoch": 0.4026203307935328,
      "grad_norm": 1.2350770235061646,
      "learning_rate": 1.821649856900084e-06,
      "loss": 0.2792,
      "mae_dtheta": 0.041209626942873,
      "mae_dx": 0.00809910986572504,
      "mae_dy": 0.0028697368688881397,
      "pose_mae_dtheta": 0.3410860002040863,
      "pose_mae_dx": 0.05631747469305992,
      "pose_mae_dy": 0.023985721170902252,
      "pose_rmse_dtheta": 0.5867612361907959,
      "pose_rmse_dx": 0.13846845924854279,
      "pose_rmse_dy": 0.07251079380512238,
      "pose_rmse_mean": 0.2659134864807129,
      "rmse_dtheta": 0.06104808673262596,
      "rmse_dx": 0.018405798822641373,
      "rmse_dy": 0.007861592806875706,
      "rmse_mean": 0.029105160385370255,
      "rotation_flip": 0.014354066923260689,
      "sparse_tokens": 24178.0,
      "step": 8666,
      "turn_loss": 0.286560595035553,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4026667905593756,
      "grad_norm": 0.41752123832702637,
      "learning_rate": 1.8206292665880821e-06,
      "loss": 0.1095,
      "mae_dtheta": 0.013573898002505302,
      "mae_dx": 0.0020116232335567474,
      "mae_dy": 0.003976326435804367,
      "pose_mae_dtheta": 0.08265005797147751,
      "pose_mae_dx": 0.030290668830275536,
      "pose_mae_dy": 0.03752479702234268,
      "pose_rmse_dtheta": 0.16814081370830536,
      "pose_rmse_dx": 0.07966823875904083,
      "pose_rmse_dy": 0.07955779880285263,
      "pose_rmse_mean": 0.10912229120731354,
      "rmse_dtheta": 0.023459840565919876,
      "rmse_dx": 0.005410337820649147,
      "rmse_dy": 0.008157261647284031,
      "rmse_mean": 0.012342480942606926,
      "rotation_flip": 0.006157635245472193,
      "sparse_tokens": 32089.0,
      "step": 8667,
      "turn_loss": 0.10822808742523193,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4027132503252184,
      "grad_norm": 0.3856920003890991,
      "learning_rate": 1.8196088986111798e-06,
      "loss": 0.0856,
      "mae_dtheta": 0.012421716935932636,
      "mae_dx": 0.0018240314675495028,
      "mae_dy": 0.003669831668958068,
      "pose_mae_dtheta": 0.08557265996932983,
      "pose_mae_dx": 0.030993858352303505,
      "pose_mae_dy": 0.04287560284137726,
      "pose_rmse_dtheta": 0.1982921063899994,
      "pose_rmse_dx": 0.09337454289197922,
      "pose_rmse_dy": 0.1213277205824852,
      "pose_rmse_mean": 0.137664794921875,
      "rmse_dtheta": 0.025487598031759262,
      "rmse_dx": 0.0051966276951134205,
      "rmse_dy": 0.009133501909673214,
      "rmse_mean": 0.013272576034069061,
      "rotation_flip": 0.0030852295458316803,
      "sparse_tokens": 32073.0,
      "step": 8668,
      "turn_loss": 0.11441212147474289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24988.0,
      "epoch": 0.40275971009106115,
      "grad_norm": 0.5320391058921814,
      "learning_rate": 1.8185887530407364e-06,
      "loss": 0.1807,
      "mae_dtheta": 0.02833879552781582,
      "mae_dx": 0.013198384083807468,
      "mae_dy": 0.005412314087152481,
      "pose_mae_dtheta": 0.20918983221054077,
      "pose_mae_dx": 0.10309288650751114,
      "pose_mae_dy": 0.06270372122526169,
      "pose_rmse_dtheta": 0.398959219455719,
      "pose_rmse_dx": 0.22891676425933838,
      "pose_rmse_dy": 0.14157924056053162,
      "pose_rmse_mean": 0.25648507475852966,
      "rmse_dtheta": 0.04632848873734474,
      "rmse_dx": 0.02622312307357788,
      "rmse_dy": 0.009577666409313679,
      "rmse_mean": 0.02737642638385296,
      "rotation_flip": 0.015570933930575848,
      "sparse_tokens": 20967.0,
      "step": 8669,
      "turn_loss": 0.2568620443344116,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.40280616985690393,
      "grad_norm": 0.5240774154663086,
      "learning_rate": 1.817568829948087e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.005119945853948593,
      "mae_dx": 0.001215292140841484,
      "mae_dy": 0.0013794359983876348,
      "pose_mae_dtheta": 0.032052237540483475,
      "pose_mae_dx": 0.015333055518567562,
      "pose_mae_dy": 0.013664910569787025,
      "pose_rmse_dtheta": 0.09151826053857803,
      "pose_rmse_dx": 0.04271203279495239,
      "pose_rmse_dy": 0.03902924433350563,
      "pose_rmse_mean": 0.057753175497055054,
      "rmse_dtheta": 0.015290927141904831,
      "rmse_dx": 0.0031394006218761206,
      "rmse_dy": 0.003968267235904932,
      "rmse_mean": 0.007466198410838842,
      "rotation_flip": 0.0008853474864736199,
      "sparse_tokens": 32153.0,
      "step": 8670,
      "turn_loss": 0.04785746708512306,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32338.0,
      "epoch": 0.4028526296227467,
      "grad_norm": 0.6826514005661011,
      "learning_rate": 1.8165491294045596e-06,
      "loss": 0.1048,
      "mae_dtheta": 0.030607841908931732,
      "mae_dx": 0.011848613619804382,
      "mae_dy": 0.004685168620198965,
      "pose_mae_dtheta": 0.2672615051269531,
      "pose_mae_dx": 0.10437463968992233,
      "pose_mae_dy": 0.06272731721401215,
      "pose_rmse_dtheta": 0.4759816527366638,
      "pose_rmse_dx": 0.24601712822914124,
      "pose_rmse_dy": 0.13962239027023315,
      "pose_rmse_mean": 0.28720706701278687,
      "rmse_dtheta": 0.04881183058023453,
      "rmse_dx": 0.02492571249604225,
      "rmse_dy": 0.010046458803117275,
      "rmse_mean": 0.027928002178668976,
      "rotation_flip": 0.006369426846504211,
      "sparse_tokens": 25045.0,
      "step": 8671,
      "turn_loss": 0.23533345758914948,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4028990893885895,
      "grad_norm": 0.47277671098709106,
      "learning_rate": 1.8155296514814585e-06,
      "loss": 0.1262,
      "mae_dtheta": 0.01139085553586483,
      "mae_dx": 0.0016921431524679065,
      "mae_dy": 0.0017739053582772613,
      "pose_mae_dtheta": 0.07938259840011597,
      "pose_mae_dx": 0.017597554251551628,
      "pose_mae_dy": 0.022759413346648216,
      "pose_rmse_dtheta": 0.24466495215892792,
      "pose_rmse_dx": 0.04724587872624397,
      "pose_rmse_dy": 0.059940580278635025,
      "pose_rmse_mean": 0.11728380620479584,
      "rmse_dtheta": 0.02797446772456169,
      "rmse_dx": 0.005123064387589693,
      "rmse_dy": 0.003964590840041637,
      "rmse_mean": 0.012354041449725628,
      "rotation_flip": 0.003225806402042508,
      "sparse_tokens": 32137.0,
      "step": 8672,
      "turn_loss": 0.07929496467113495,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.40294554915443226,
      "grad_norm": 0.35635045170783997,
      "learning_rate": 1.8145103962500792e-06,
      "loss": 0.0779,
      "mae_dtheta": 0.006217532325536013,
      "mae_dx": 0.0012345864670351148,
      "mae_dy": 0.0005683196941390634,
      "pose_mae_dtheta": 0.04393778368830681,
      "pose_mae_dx": 0.01006424892693758,
      "pose_mae_dy": 0.008410212583839893,
      "pose_rmse_dtheta": 0.19680452346801758,
      "pose_rmse_dx": 0.025624871253967285,
      "pose_rmse_dy": 0.026675265282392502,
      "pose_rmse_mean": 0.08303488790988922,
      "rmse_dtheta": 0.023188691586256027,
      "rmse_dx": 0.003917450085282326,
      "rmse_dy": 0.0015083008911460638,
      "rmse_mean": 0.00953814759850502,
      "rotation_flip": 0.0018927444471046329,
      "sparse_tokens": 32137.0,
      "step": 8673,
      "turn_loss": 0.04350128397345543,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.40299200892027504,
      "grad_norm": 0.5285884141921997,
      "learning_rate": 1.8134913637816981e-06,
      "loss": 0.114,
      "mae_dtheta": 0.03261202946305275,
      "mae_dx": 0.011991981416940689,
      "mae_dy": 0.005033554974943399,
      "pose_mae_dtheta": 0.25205424427986145,
      "pose_mae_dx": 0.11317147314548492,
      "pose_mae_dy": 0.054349713027477264,
      "pose_rmse_dtheta": 0.4619884490966797,
      "pose_rmse_dx": 0.24750326573848724,
      "pose_rmse_dy": 0.10907387733459473,
      "pose_rmse_mean": 0.2728552222251892,
      "rmse_dtheta": 0.05029032751917839,
      "rmse_dx": 0.02450934611260891,
      "rmse_dy": 0.00858309492468834,
      "rmse_mean": 0.027794256806373596,
      "rotation_flip": 0.011678831651806831,
      "sparse_tokens": 11550.0,
      "step": 8674,
      "turn_loss": 0.26287272572517395,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.4030384686861178,
      "grad_norm": 0.4903091788291931,
      "learning_rate": 1.8124725541475747e-06,
      "loss": 0.1029,
      "mae_dtheta": 0.03054712526500225,
      "mae_dx": 0.011893905699253082,
      "mae_dy": 0.002784075913950801,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4903091490268707,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.7844696044922,
      "model/head/act_norm_mean": 110.6967150099734,
      "model/head/act_norm_min": 74.93399810791016,
      "model/head/act_over_embed": 76.07181891382774,
      "model/head/grad_frac": 0.09809622168540955,
      "model/head/grad_norm": 0.04809747636318207,
      "model/head/grad_zero_frac": 0.00019766030891332775,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6802900598404256,
      "model/head/update_ratio": 0.0008191699744202197,
      "model/head/weight_delta": 9.809574127197266,
      "model/head/weight_delta_rel": 0.17208898067474365,
      "model/head/weight_norm": 58.71489334106445,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42246609926223755,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42241644859313965,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42236000299453735,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.290288538198305,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1634511798620224,
      "model/modality_embedder.encoders.pose/grad_norm": 0.08014161139726639,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.538818359375,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002587876981124282,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1211068630218506,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10197629034519196,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96809196472168,
      "model/modality_embedder/grad_frac": 0.1634511798620224,
      "model/modality_embedder/grad_norm": 0.08014161139726639,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.538818359375,
      "model/modality_embedder/update_ratio": 0.002587876981124282,
      "model/modality_embedder/weight_delta": 3.1211068630218506,
      "model/modality_embedder/weight_delta_rel": 0.10197629034519196,
      "model/modality_embedder/weight_norm": 30.96809196472168,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.50072479248047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.77076209473151,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.167000770568848,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.335490256880483,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07375328987836838,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.036161914467811584,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001294226967729628,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6537556648254395,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09670446068048477,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.940937042236328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.95514678955078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.627519735731173,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.653129577636719,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.92426212886686,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06747323274612427,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0330827422440052,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011124355951324105,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.364602565765381,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11655246466398239,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.739017486572266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.83863830566406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.306117548969944,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.994922637939453,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.07781026140487,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06993352621793747,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03428904712200165,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011166200274601579,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6399614810943604,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12222309410572052,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.7078914642334,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.75859069824219,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.12275730327592,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.963935852050781,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.32622210821328,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06295990198850632,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03086981549859047,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010314405662938952,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.12290096282959,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10672593116760254,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.928834915161133,
      "model/normalizer/grad_frac": 0.2330029159784317,
      "model/normalizer/grad_norm": 0.11424346268177032,
      "model/normalizer/grad_zero_frac": 0.0002328024711459875,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014530724147334695,
      "model/normalizer/weight_delta": 6.5812764167785645,
      "model/normalizer/weight_delta_rel": 0.08476302772760391,
      "model/normalizer/weight_norm": 78.62200164794922,
      "pose_mae_dtheta": 0.22119860351085663,
      "pose_mae_dx": 0.0988190546631813,
      "pose_mae_dy": 0.03471389412879944,
      "pose_rmse_dtheta": 0.4020235538482666,
      "pose_rmse_dx": 0.21229329705238342,
      "pose_rmse_dy": 0.08895120024681091,
      "pose_rmse_mean": 0.2344226837158203,
      "rmse_dtheta": 0.04844466596841812,
      "rmse_dx": 0.023497598245739937,
      "rmse_dy": 0.006597650237381458,
      "rmse_mean": 0.026179973036050797,
      "rotation_flip": 0.006756756920367479,
      "sparse_tokens": 12342.0,
      "step": 8675,
      "turn_loss": 0.21376514434814453,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4030849284519606,
      "grad_norm": 0.4827384948730469,
      "learning_rate": 1.8114539674189564e-06,
      "loss": 0.0859,
      "mae_dtheta": 0.010442221537232399,
      "mae_dx": 0.0010908967815339565,
      "mae_dy": 0.0024551490787416697,
      "pose_mae_dtheta": 0.0633179172873497,
      "pose_mae_dx": 0.019938796758651733,
      "pose_mae_dy": 0.030653148889541626,
      "pose_rmse_dtheta": 0.13338641822338104,
      "pose_rmse_dx": 0.05379396304488182,
      "pose_rmse_dy": 0.07029014825820923,
      "pose_rmse_mean": 0.08582352101802826,
      "rmse_dtheta": 0.019683564081788063,
      "rmse_dx": 0.0032723674084991217,
      "rmse_dy": 0.004746947903186083,
      "rmse_mean": 0.0092342933639884,
      "rotation_flip": 0.006540697533637285,
      "sparse_tokens": 32041.0,
      "step": 8676,
      "turn_loss": 0.07960235327482224,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.40313138821780337,
      "grad_norm": 0.5840805768966675,
      "learning_rate": 1.810435603667075e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.04442529007792473,
      "mae_dx": 0.00939266849309206,
      "mae_dy": 0.0051945531740784645,
      "pose_mae_dtheta": 0.36322319507598877,
      "pose_mae_dx": 0.07624951004981995,
      "pose_mae_dy": 0.06928395479917526,
      "pose_rmse_dtheta": 0.6677559018135071,
      "pose_rmse_dx": 0.17432661354541779,
      "pose_rmse_dy": 0.14882135391235352,
      "pose_rmse_mean": 0.33030128479003906,
      "rmse_dtheta": 0.06664087623357773,
      "rmse_dx": 0.021284470334649086,
      "rmse_dy": 0.010431728325784206,
      "rmse_mean": 0.03278569132089615,
      "rotation_flip": 0.02214650809764862,
      "sparse_tokens": 10406.0,
      "step": 8677,
      "turn_loss": 0.2308003306388855,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 5532.0,
      "epoch": 0.40317784798364614,
      "grad_norm": 0.8487982153892517,
      "learning_rate": 1.8094174629631423e-06,
      "loss": 0.1434,
      "mae_dtheta": 0.027147848159074783,
      "mae_dx": 0.015236962586641312,
      "mae_dy": 0.010360486805438995,
      "pose_mae_dtheta": 0.21381612122058868,
      "pose_mae_dx": 0.12894059717655182,
      "pose_mae_dy": 0.18446148931980133,
      "pose_rmse_dtheta": 0.3637576401233673,
      "pose_rmse_dx": 0.2643332779407501,
      "pose_rmse_dy": 0.3407394587993622,
      "pose_rmse_mean": 0.32294344902038574,
      "rmse_dtheta": 0.04273708164691925,
      "rmse_dx": 0.03079049661755562,
      "rmse_dy": 0.014624896459281445,
      "rmse_mean": 0.029384156689047813,
      "rotation_flip": 0.018018018454313278,
      "sparse_tokens": 4787.0,
      "step": 8678,
      "turn_loss": 0.2793152630329132,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 30494.0,
      "epoch": 0.4032243077494889,
      "grad_norm": 0.34224560856819153,
      "learning_rate": 1.8083995453783604e-06,
      "loss": 0.0924,
      "mae_dtheta": 0.030738590285182,
      "mae_dx": 0.010340669192373753,
      "mae_dy": 0.0028572515584528446,
      "pose_mae_dtheta": 0.22806333005428314,
      "pose_mae_dx": 0.0828101709485054,
      "pose_mae_dy": 0.02906220033764839,
      "pose_rmse_dtheta": 0.43614664673805237,
      "pose_rmse_dx": 0.1999969184398651,
      "pose_rmse_dy": 0.07055911421775818,
      "pose_rmse_mean": 0.23556756973266602,
      "rmse_dtheta": 0.04965580999851227,
      "rmse_dx": 0.022146260365843773,
      "rmse_dy": 0.006138574331998825,
      "rmse_mean": 0.025980215519666672,
      "rotation_flip": 0.011259675957262516,
      "sparse_tokens": 24810.0,
      "step": 8679,
      "turn_loss": 0.2153634876012802,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4032707675153317,
      "grad_norm": 0.5329850316047668,
      "learning_rate": 1.8073818509839097e-06,
      "loss": 0.1436,
      "mae_dtheta": 0.007699207868427038,
      "mae_dx": 0.0012994975550100207,
      "mae_dy": 0.0020014101173728704,
      "pose_mae_dtheta": 0.05067646875977516,
      "pose_mae_dx": 0.016135241836309433,
      "pose_mae_dy": 0.02261248417198658,
      "pose_rmse_dtheta": 0.11133977025747299,
      "pose_rmse_dx": 0.03988640382885933,
      "pose_rmse_dy": 0.05231761932373047,
      "pose_rmse_mean": 0.06784793734550476,
      "rmse_dtheta": 0.01846722513437271,
      "rmse_dx": 0.004843740724027157,
      "rmse_dy": 0.004800543189048767,
      "rmse_mean": 0.009370503947138786,
      "rotation_flip": 0.003706754418089986,
      "sparse_tokens": 32089.0,
      "step": 8680,
      "turn_loss": 0.06566204875707626,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.40331722728117453,
      "grad_norm": 0.4184541404247284,
      "learning_rate": 1.8063643798509594e-06,
      "loss": 0.1038,
      "mae_dtheta": 0.009356350637972355,
      "mae_dx": 0.0017684922786429524,
      "mae_dy": 0.002196644200012088,
      "pose_mae_dtheta": 0.05669436976313591,
      "pose_mae_dx": 0.021025069057941437,
      "pose_mae_dy": 0.02425641566514969,
      "pose_rmse_dtheta": 0.11926518380641937,
      "pose_rmse_dx": 0.056050628423690796,
      "pose_rmse_dy": 0.05067461356520653,
      "pose_rmse_mean": 0.07533014565706253,
      "rmse_dtheta": 0.018765205517411232,
      "rmse_dx": 0.005527145694941282,
      "rmse_dy": 0.004658278543502092,
      "rmse_mean": 0.009650209918618202,
      "rotation_flip": 0.0036049026530236006,
      "sparse_tokens": 32121.0,
      "step": 8681,
      "turn_loss": 0.09048258513212204,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4033636870470173,
      "grad_norm": 0.3652464747428894,
      "learning_rate": 1.8053471320506644e-06,
      "loss": 0.088,
      "mae_dtheta": 0.00913543812930584,
      "mae_dx": 0.0015934733673930168,
      "mae_dy": 0.0020735962316393852,
      "pose_mae_dtheta": 0.06534028798341751,
      "pose_mae_dx": 0.017232153564691544,
      "pose_mae_dy": 0.02317403070628643,
      "pose_rmse_dtheta": 0.17600677907466888,
      "pose_rmse_dx": 0.05317113921046257,
      "pose_rmse_dy": 0.06215984374284744,
      "pose_rmse_mean": 0.09711258858442307,
      "rmse_dtheta": 0.021836044266819954,
      "rmse_dx": 0.005490047391504049,
      "rmse_dy": 0.006575357168912888,
      "rmse_mean": 0.011300483718514442,
      "rotation_flip": 0.006518404930830002,
      "sparse_tokens": 32153.0,
      "step": 8682,
      "turn_loss": 0.08025145530700684,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4034101468128601,
      "grad_norm": 0.5305693745613098,
      "learning_rate": 1.8043301076541575e-06,
      "loss": 0.103,
      "mae_dtheta": 0.010782464407384396,
      "mae_dx": 0.003498219884932041,
      "mae_dy": 0.002615484409034252,
      "pose_mae_dtheta": 0.08520568907260895,
      "pose_mae_dx": 0.03003535605967045,
      "pose_mae_dy": 0.024264995008707047,
      "pose_rmse_dtheta": 0.24040661752223969,
      "pose_rmse_dx": 0.07169488072395325,
      "pose_rmse_dy": 0.06386683136224747,
      "pose_rmse_mean": 0.12532277405261993,
      "rmse_dtheta": 0.027096373960375786,
      "rmse_dx": 0.009242012165486813,
      "rmse_dy": 0.007416102569550276,
      "rmse_mean": 0.014584830030798912,
      "rotation_flip": 0.004380201455205679,
      "sparse_tokens": 32185.0,
      "step": 8683,
      "turn_loss": 0.10688094794750214,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40345660657870286,
      "grad_norm": 0.5143338441848755,
      "learning_rate": 1.8033133067325625e-06,
      "loss": 0.0739,
      "mae_dtheta": 0.008780411444604397,
      "mae_dx": 0.0014201706508174539,
      "mae_dy": 0.0019319099374115467,
      "pose_mae_dtheta": 0.056516848504543304,
      "pose_mae_dx": 0.01810377463698387,
      "pose_mae_dy": 0.024260636419057846,
      "pose_rmse_dtheta": 0.12927111983299255,
      "pose_rmse_dx": 0.04222780093550682,
      "pose_rmse_dy": 0.053315624594688416,
      "pose_rmse_mean": 0.07493818551301956,
      "rmse_dtheta": 0.02021181397140026,
      "rmse_dx": 0.0040998985059559345,
      "rmse_dy": 0.0038540910463780165,
      "rmse_mean": 0.009388601407408714,
      "rotation_flip": 0.0041562761180102825,
      "sparse_tokens": 32105.0,
      "step": 8684,
      "turn_loss": 0.07322628796100616,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.40350306634454564,
      "grad_norm": 0.5960323810577393,
      "learning_rate": 1.8022967293569826e-06,
      "loss": 0.1719,
      "mae_dtheta": 0.02617272548377514,
      "mae_dx": 0.009260416962206364,
      "mae_dy": 0.005015758331865072,
      "pose_mae_dtheta": 0.18863950669765472,
      "pose_mae_dx": 0.07929527759552002,
      "pose_mae_dy": 0.06221102550625801,
      "pose_rmse_dtheta": 0.3152063190937042,
      "pose_rmse_dx": 0.17844951152801514,
      "pose_rmse_dy": 0.15033996105194092,
      "pose_rmse_mean": 0.2146652638912201,
      "rmse_dtheta": 0.041153959929943085,
      "rmse_dx": 0.020075438544154167,
      "rmse_dy": 0.01027046237140894,
      "rmse_mean": 0.02383328787982464,
      "rotation_flip": 0.03030303120613098,
      "sparse_tokens": 24965.0,
      "step": 8685,
      "turn_loss": 0.22827202081680298,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.4035495261103884,
      "grad_norm": 0.5969424247741699,
      "learning_rate": 1.8012803755985098e-06,
      "loss": 0.1737,
      "mae_dtheta": 0.023848915472626686,
      "mae_dx": 0.012651816941797733,
      "mae_dy": 0.0059364489279687405,
      "pose_mae_dtheta": 0.15878379344940186,
      "pose_mae_dx": 0.10784865915775299,
      "pose_mae_dy": 0.0889522060751915,
      "pose_rmse_dtheta": 0.28092899918556213,
      "pose_rmse_dx": 0.2491179257631302,
      "pose_rmse_dy": 0.19074130058288574,
      "pose_rmse_mean": 0.24026274681091309,
      "rmse_dtheta": 0.03898226097226143,
      "rmse_dx": 0.027958137914538383,
      "rmse_dy": 0.011437329463660717,
      "rmse_mean": 0.02612590789794922,
      "rotation_flip": 0.007444168906658888,
      "sparse_tokens": 9493.0,
      "step": 8686,
      "turn_loss": 0.21839791536331177,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4035959858762312,
      "grad_norm": 0.9617615938186646,
      "learning_rate": 1.800264245528216e-06,
      "loss": 0.2077,
      "mae_dtheta": 0.015480808913707733,
      "mae_dx": 0.004849445540457964,
      "mae_dy": 0.005250070244073868,
      "pose_mae_dtheta": 0.11015724390745163,
      "pose_mae_dx": 0.05511520802974701,
      "pose_mae_dy": 0.045684073120355606,
      "pose_rmse_dtheta": 0.25128963589668274,
      "pose_rmse_dx": 0.1415431797504425,
      "pose_rmse_dy": 0.10453256964683533,
      "pose_rmse_mean": 0.165788471698761,
      "rmse_dtheta": 0.029977869242429733,
      "rmse_dx": 0.012221790850162506,
      "rmse_dy": 0.011814181692898273,
      "rmse_mean": 0.018004614859819412,
      "rotation_flip": 0.010252654552459717,
      "sparse_tokens": 32105.0,
      "step": 8687,
      "turn_loss": 0.15627487003803253,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.40364244564207397,
      "grad_norm": 0.6146714091300964,
      "learning_rate": 1.7992483392171612e-06,
      "loss": 0.1208,
      "mae_dtheta": 0.0537271685898304,
      "mae_dx": 0.010785325430333614,
      "mae_dy": 0.015283583663403988,
      "pose_mae_dtheta": 0.46379518508911133,
      "pose_mae_dx": 0.0956592783331871,
      "pose_mae_dy": 0.12028768658638,
      "pose_rmse_dtheta": 0.7385523319244385,
      "pose_rmse_dx": 0.25161316990852356,
      "pose_rmse_dy": 0.2944676876068115,
      "pose_rmse_mean": 0.4282110631465912,
      "rmse_dtheta": 0.07541092485189438,
      "rmse_dx": 0.021412968635559082,
      "rmse_dy": 0.030676210299134254,
      "rmse_mean": 0.04250003397464752,
      "rotation_flip": 0.00913241971284151,
      "sparse_tokens": 3516.0,
      "step": 8688,
      "turn_loss": 0.5188733339309692,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.40368890540791674,
      "grad_norm": 0.5812487602233887,
      "learning_rate": 1.798232656736389e-06,
      "loss": 0.1802,
      "mae_dtheta": 0.044089023023843765,
      "mae_dx": 0.020261934027075768,
      "mae_dy": 0.008013473823666573,
      "pose_mae_dtheta": 0.32112917304039,
      "pose_mae_dx": 0.16016198694705963,
      "pose_mae_dy": 0.09439429640769958,
      "pose_rmse_dtheta": 0.5329688191413879,
      "pose_rmse_dx": 0.30842408537864685,
      "pose_rmse_dy": 0.21956804394721985,
      "pose_rmse_mean": 0.3536536395549774,
      "rmse_dtheta": 0.060153521597385406,
      "rmse_dx": 0.03426481783390045,
      "rmse_dy": 0.018398264423012733,
      "rmse_mean": 0.03760553523898125,
      "rotation_flip": 0.017123287543654442,
      "sparse_tokens": 10125.0,
      "step": 8689,
      "turn_loss": 0.36681514978408813,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4037353651737595,
      "grad_norm": 0.46193933486938477,
      "learning_rate": 1.7972171981569241e-06,
      "loss": 0.1067,
      "mae_dtheta": 0.008569960482418537,
      "mae_dx": 0.0016648153541609645,
      "mae_dy": 0.001303533441387117,
      "pose_mae_dtheta": 0.06373665481805801,
      "pose_mae_dx": 0.013490097597241402,
      "pose_mae_dy": 0.010881613940000534,
      "pose_rmse_dtheta": 0.24209603667259216,
      "pose_rmse_dx": 0.04761656001210213,
      "pose_rmse_dy": 0.029944561421871185,
      "pose_rmse_mean": 0.10655239224433899,
      "rmse_dtheta": 0.026905106380581856,
      "rmse_dx": 0.005232059396803379,
      "rmse_dy": 0.00442458363249898,
      "rmse_mean": 0.012187249958515167,
      "rotation_flip": 0.004217431880533695,
      "sparse_tokens": 32169.0,
      "step": 8690,
      "turn_loss": 0.05842858552932739,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4037818249396023,
      "grad_norm": 0.3506397306919098,
      "learning_rate": 1.7962019635497812e-06,
      "loss": 0.0783,
      "mae_dtheta": 0.006849709432572126,
      "mae_dx": 0.0012505620252341032,
      "mae_dy": 0.0015708502614870667,
      "pose_mae_dtheta": 0.045740965753793716,
      "pose_mae_dx": 0.01480784546583891,
      "pose_mae_dy": 0.020192870870232582,
      "pose_rmse_dtheta": 0.11140234023332596,
      "pose_rmse_dx": 0.04102803394198418,
      "pose_rmse_dy": 0.05648051202297211,
      "pose_rmse_mean": 0.06963696330785751,
      "rmse_dtheta": 0.01607063040137291,
      "rmse_dx": 0.00433422951027751,
      "rmse_dy": 0.004238637164235115,
      "rmse_mean": 0.008214499801397324,
      "rotation_flip": 0.001135718310251832,
      "sparse_tokens": 32057.0,
      "step": 8691,
      "turn_loss": 0.05955606698989868,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4038282847054451,
      "grad_norm": 0.38513681292533875,
      "learning_rate": 1.7951869529859534e-06,
      "loss": 0.0673,
      "mae_dtheta": 0.0068753124214708805,
      "mae_dx": 0.0010902289068326354,
      "mae_dy": 0.0006805931334383786,
      "pose_mae_dtheta": 0.05110052973031998,
      "pose_mae_dx": 0.009389697574079037,
      "pose_mae_dy": 0.01074561383575201,
      "pose_rmse_dtheta": 0.20632191002368927,
      "pose_rmse_dx": 0.026425210759043694,
      "pose_rmse_dy": 0.03426278755068779,
      "pose_rmse_mean": 0.0890033096075058,
      "rmse_dtheta": 0.023536093533039093,
      "rmse_dx": 0.0031876154243946075,
      "rmse_dy": 0.0019643502309918404,
      "rmse_mean": 0.009562686085700989,
      "rotation_flip": 0.002370791742578149,
      "sparse_tokens": 32201.0,
      "step": 8692,
      "turn_loss": 0.037704113870859146,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.40387474447128785,
      "grad_norm": 0.5333283543586731,
      "learning_rate": 1.7941721665364232e-06,
      "loss": 0.1428,
      "mae_dtheta": 0.008037606254220009,
      "mae_dx": 0.0017839822685346007,
      "mae_dy": 0.001226534484885633,
      "pose_mae_dtheta": 0.058846861124038696,
      "pose_mae_dx": 0.014830959029495716,
      "pose_mae_dy": 0.013513768091797829,
      "pose_rmse_dtheta": 0.21068623661994934,
      "pose_rmse_dx": 0.035680659115314484,
      "pose_rmse_dy": 0.03800538554787636,
      "pose_rmse_mean": 0.0947907567024231,
      "rmse_dtheta": 0.023953663185238838,
      "rmse_dx": 0.005173377227038145,
      "rmse_dy": 0.00377010484226048,
      "rmse_mean": 0.010965715162456036,
      "rotation_flip": 0.0039595249108970165,
      "sparse_tokens": 32185.0,
      "step": 8693,
      "turn_loss": 0.07352486997842789,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32662.0,
      "epoch": 0.4039212042371306,
      "grad_norm": 0.4192703068256378,
      "learning_rate": 1.7931576042721527e-06,
      "loss": 0.1215,
      "mae_dtheta": 0.033545542508363724,
      "mae_dx": 0.014948062598705292,
      "mae_dy": 0.006170731037855148,
      "pose_mae_dtheta": 0.26515454053878784,
      "pose_mae_dx": 0.1288735419511795,
      "pose_mae_dy": 0.06305834650993347,
      "pose_rmse_dtheta": 0.49512583017349243,
      "pose_rmse_dx": 0.26124200224876404,
      "pose_rmse_dy": 0.20556944608688354,
      "pose_rmse_mean": 0.3206457495689392,
      "rmse_dtheta": 0.052502114325761795,
      "rmse_dx": 0.026498494669795036,
      "rmse_dy": 0.015551593154668808,
      "rmse_mean": 0.031517401337623596,
      "rotation_flip": 0.008462623693048954,
      "sparse_tokens": 26565.0,
      "step": 8694,
      "turn_loss": 0.3020399808883667,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 37847.0,
      "epoch": 0.4039676640029734,
      "grad_norm": 0.4952569007873535,
      "learning_rate": 1.792143266264092e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.030204491689801216,
      "mae_dx": 0.011461816728115082,
      "mae_dy": 0.0030299597419798374,
      "pose_mae_dtheta": 0.23764361441135406,
      "pose_mae_dx": 0.08943629264831543,
      "pose_mae_dy": 0.030378974974155426,
      "pose_rmse_dtheta": 0.44995805621147156,
      "pose_rmse_dx": 0.21517011523246765,
      "pose_rmse_dy": 0.08167663216590881,
      "pose_rmse_mean": 0.24893495440483093,
      "rmse_dtheta": 0.048457756638526917,
      "rmse_dx": 0.023876143619418144,
      "rmse_dy": 0.006568956654518843,
      "rmse_mean": 0.026300951838493347,
      "rotation_flip": 0.010619468986988068,
      "sparse_tokens": 28298.0,
      "step": 8695,
      "turn_loss": 0.23770125210285187,
      "turns": 117.0,
      "turns_per_sample": 117.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.4040141237688162,
      "grad_norm": 0.5462914705276489,
      "learning_rate": 1.7911291525831764e-06,
      "loss": 0.0979,
      "mae_dtheta": 0.04048110172152519,
      "mae_dx": 0.009439751505851746,
      "mae_dy": 0.004320012871176004,
      "pose_mae_dtheta": 0.33547577261924744,
      "pose_mae_dx": 0.07141947746276855,
      "pose_mae_dy": 0.04552558436989784,
      "pose_rmse_dtheta": 0.576546847820282,
      "pose_rmse_dx": 0.15953630208969116,
      "pose_rmse_dy": 0.10977168381214142,
      "pose_rmse_mean": 0.2819516062736511,
      "rmse_dtheta": 0.05839836597442627,
      "rmse_dx": 0.020338797941803932,
      "rmse_dy": 0.00834864191710949,
      "rmse_mean": 0.029028601944446564,
      "rotation_flip": 0.01886792480945587,
      "sparse_tokens": 16809.0,
      "step": 8696,
      "turn_loss": 0.29483717679977417,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.404060583534659,
      "grad_norm": 0.46307188272476196,
      "learning_rate": 1.7901152633003194e-06,
      "loss": 0.084,
      "mae_dtheta": 0.007667426485568285,
      "mae_dx": 0.0016854606801643968,
      "mae_dy": 0.0018673063023015857,
      "pose_mae_dtheta": 0.05153406411409378,
      "pose_mae_dx": 0.018398704007267952,
      "pose_mae_dy": 0.02082856558263302,
      "pose_rmse_dtheta": 0.10901050269603729,
      "pose_rmse_dx": 0.04272838681936264,
      "pose_rmse_dy": 0.049388181418180466,
      "pose_rmse_mean": 0.06704235821962357,
      "rmse_dtheta": 0.01602611318230629,
      "rmse_dx": 0.004808579571545124,
      "rmse_dy": 0.004292333032935858,
      "rmse_mean": 0.008375675417482853,
      "rotation_flip": 0.006338028237223625,
      "sparse_tokens": 32217.0,
      "step": 8697,
      "turn_loss": 0.06908305734395981,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4041070433005018,
      "grad_norm": 0.5424461960792542,
      "learning_rate": 1.789101598486427e-06,
      "loss": 0.1205,
      "mae_dtheta": 0.011897330172359943,
      "mae_dx": 0.0016577697824686766,
      "mae_dy": 0.002699487376958132,
      "pose_mae_dtheta": 0.07971009612083435,
      "pose_mae_dx": 0.021754901856184006,
      "pose_mae_dy": 0.027240116149187088,
      "pose_rmse_dtheta": 0.19342680275440216,
      "pose_rmse_dx": 0.052170008420944214,
      "pose_rmse_dy": 0.06748135387897491,
      "pose_rmse_mean": 0.10435938835144043,
      "rmse_dtheta": 0.02642836421728134,
      "rmse_dx": 0.004488854669034481,
      "rmse_dy": 0.00657501770183444,
      "rmse_mean": 0.012497412972152233,
      "rotation_flip": 0.003863987745717168,
      "sparse_tokens": 32137.0,
      "step": 8698,
      "turn_loss": 0.09253853559494019,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.40415350306634457,
      "grad_norm": 0.7976674437522888,
      "learning_rate": 1.7880881582123816e-06,
      "loss": 0.1681,
      "mae_dtheta": 0.03764542564749718,
      "mae_dx": 0.00983259454369545,
      "mae_dy": 0.006038794759660959,
      "pose_mae_dtheta": 0.2718023955821991,
      "pose_mae_dx": 0.0847616195678711,
      "pose_mae_dy": 0.0628543347120285,
      "pose_rmse_dtheta": 0.43713995814323425,
      "pose_rmse_dx": 0.16126267611980438,
      "pose_rmse_dy": 0.15600916743278503,
      "pose_rmse_mean": 0.2514706254005432,
      "rmse_dtheta": 0.05372941121459007,
      "rmse_dx": 0.01948034204542637,
      "rmse_dy": 0.014052769169211388,
      "rmse_mean": 0.029087509959936142,
      "rotation_flip": 0.014238772913813591,
      "sparse_tokens": 14479.0,
      "step": 8699,
      "turn_loss": 0.3485812842845917,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.40419996283218734,
      "grad_norm": 0.84535813331604,
      "learning_rate": 1.7870749425490548e-06,
      "loss": 0.2175,
      "mae_dtheta": 0.02268725447356701,
      "mae_dx": 0.009446433745324612,
      "mae_dy": 0.0022251855116337538,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8453580737113953,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.7664337158203,
      "model/head/act_norm_mean": 104.57056949013158,
      "model/head/act_norm_min": 51.453819274902344,
      "model/head/act_over_embed": 71.86187435871446,
      "model/head/grad_frac": 0.10429685562849045,
      "model/head/grad_norm": 0.0881681889295578,
      "model/head/grad_zero_frac": 0.00023478110961150378,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6899928042763158,
      "model/head/update_ratio": 0.0015016131801530719,
      "model/head/weight_delta": 9.813586235046387,
      "model/head/weight_delta_rel": 0.1721593737602234,
      "model/head/weight_norm": 58.71564865112305,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42248427867889404,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4224231426532452,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42237553000450134,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29029313841908033,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09464621543884277,
      "model/modality_embedder.encoders.pose/grad_norm": 0.08000994473695755,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5424178685897436,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0025836206041276455,
      "model/modality_embedder.encoders.pose/weight_delta": 3.122419834136963,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10201919078826904,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968149185180664,
      "model/modality_embedder/grad_frac": 0.09464621543884277,
      "model/modality_embedder/grad_norm": 0.08000994473695755,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5424178685897436,
      "model/modality_embedder/update_ratio": 0.0025836206041276455,
      "model/modality_embedder/weight_delta": 3.122419834136963,
      "model/modality_embedder/weight_delta_rel": 0.10201919078826904,
      "model/modality_embedder/weight_norm": 30.968149185180664,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.490234375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.17351810515873,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.15204906463623,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.925058595759745,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06443239003419876,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.054468441754579544,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003379196277819574,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019493731670081615,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.655596971511841,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09677155315876007,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.941516876220703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.20771026611328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.032424812030076,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.5078763961792,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.515307325933016,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0661054253578186,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05588275194168091,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002975710085593164,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018790739122778177,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.366919994354248,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11663273721933365,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.739517211914062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.94474029541016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.703027098997495,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.111746788024902,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.663360857962054,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05977733060717583,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05053324997425079,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000363137514796108,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00164557876996696,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6425223350524902,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12230908125638962,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.70849609375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.77506256103516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.51548141186299,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.113324165344238,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.90889643022784,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05124460533261299,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04332004114985466,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0003026145859621465,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014474064810201526,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1251380443573,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10680238902568817,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.92942237854004,
      "model/normalizer/grad_frac": 0.1981411874294281,
      "model/normalizer/grad_norm": 0.16750025749206543,
      "model/normalizer/grad_zero_frac": 0.0003214328608009964,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002130429958924651,
      "model/normalizer/weight_delta": 6.585892677307129,
      "model/normalizer/weight_delta_rel": 0.08482248336076736,
      "model/normalizer/weight_norm": 78.62274932861328,
      "pose_mae_dtheta": 0.14880076050758362,
      "pose_mae_dx": 0.0627562627196312,
      "pose_mae_dy": 0.030237538740038872,
      "pose_rmse_dtheta": 0.29247286915779114,
      "pose_rmse_dx": 0.164836123585701,
      "pose_rmse_dy": 0.06916836649179459,
      "pose_rmse_mean": 0.17549246549606323,
      "rmse_dtheta": 0.04086663946509361,
      "rmse_dx": 0.021420927718281746,
      "rmse_dy": 0.004991641268134117,
      "rmse_mean": 0.022426404058933258,
      "rotation_flip": 0.005376344081014395,
      "sparse_tokens": 9897.0,
      "step": 8700,
      "turn_loss": 0.1526186168193817,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.4042464225980301,
      "grad_norm": 0.5842471122741699,
      "learning_rate": 1.7860619515673034e-06,
      "loss": 0.1464,
      "mae_dtheta": 0.027356738224625587,
      "mae_dx": 0.01114598661661148,
      "mae_dy": 0.00446578161790967,
      "pose_mae_dtheta": 0.20828606188297272,
      "pose_mae_dx": 0.09703724086284637,
      "pose_mae_dy": 0.05355747789144516,
      "pose_rmse_dtheta": 0.3320409655570984,
      "pose_rmse_dx": 0.20500975847244263,
      "pose_rmse_dy": 0.12422636151313782,
      "pose_rmse_mean": 0.22042569518089294,
      "rmse_dtheta": 0.041820649057626724,
      "rmse_dx": 0.02194610983133316,
      "rmse_dy": 0.008920860476791859,
      "rmse_mean": 0.02422920987010002,
      "rotation_flip": 0.001805054140277207,
      "sparse_tokens": 11473.0,
      "step": 8701,
      "turn_loss": 0.2323532998561859,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.4042928823638729,
      "grad_norm": 0.37847426533699036,
      "learning_rate": 1.785049185337963e-06,
      "loss": 0.0871,
      "mae_dtheta": 0.024743331596255302,
      "mae_dx": 0.009999191388487816,
      "mae_dy": 0.0025121814105659723,
      "pose_mae_dtheta": 0.19512741267681122,
      "pose_mae_dx": 0.07712730020284653,
      "pose_mae_dy": 0.028878221288323402,
      "pose_rmse_dtheta": 0.3530378043651581,
      "pose_rmse_dx": 0.1582525074481964,
      "pose_rmse_dy": 0.07076863199472427,
      "pose_rmse_mean": 0.19401966035366058,
      "rmse_dtheta": 0.04176418110728264,
      "rmse_dx": 0.020631959661841393,
      "rmse_dy": 0.005147246643900871,
      "rmse_mean": 0.0225144624710083,
      "rotation_flip": 0.010395010001957417,
      "sparse_tokens": 18040.0,
      "step": 8702,
      "turn_loss": 0.21764284372329712,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4043393421297157,
      "grad_norm": 0.4201847016811371,
      "learning_rate": 1.7840366439318608e-06,
      "loss": 0.0631,
      "mae_dtheta": 0.007175130769610405,
      "mae_dx": 0.0012114852434024215,
      "mae_dy": 0.0015344420680776238,
      "pose_mae_dtheta": 0.04387389123439789,
      "pose_mae_dx": 0.013414449989795685,
      "pose_mae_dy": 0.017351703718304634,
      "pose_rmse_dtheta": 0.11955393850803375,
      "pose_rmse_dx": 0.03279842436313629,
      "pose_rmse_dy": 0.042610034346580505,
      "pose_rmse_mean": 0.06498746573925018,
      "rmse_dtheta": 0.0179875697940588,
      "rmse_dx": 0.004011877812445164,
      "rmse_dy": 0.004441082943230867,
      "rmse_mean": 0.008813510648906231,
      "rotation_flip": 0.0018682858208194375,
      "sparse_tokens": 32089.0,
      "step": 8703,
      "turn_loss": 0.0629739984869957,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.40438580189555845,
      "grad_norm": 0.6464158892631531,
      "learning_rate": 1.7830243274198005e-06,
      "loss": 0.107,
      "mae_dtheta": 0.03251988813281059,
      "mae_dx": 0.009703145362436771,
      "mae_dy": 0.004017706029117107,
      "pose_mae_dtheta": 0.2603951096534729,
      "pose_mae_dx": 0.07910574227571487,
      "pose_mae_dy": 0.08250260353088379,
      "pose_rmse_dtheta": 0.4399171471595764,
      "pose_rmse_dx": 0.20797279477119446,
      "pose_rmse_dy": 0.229511559009552,
      "pose_rmse_mean": 0.2924671769142151,
      "rmse_dtheta": 0.04966219887137413,
      "rmse_dx": 0.021600957959890366,
      "rmse_dy": 0.009584288112819195,
      "rmse_mean": 0.026949148625135422,
      "rotation_flip": 0.005479452200233936,
      "sparse_tokens": 8149.0,
      "step": 8704,
      "turn_loss": 0.22638101875782013,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4044322616614012,
      "grad_norm": 0.533423662185669,
      "learning_rate": 1.7820122358725772e-06,
      "loss": 0.0894,
      "mae_dtheta": 0.006221968214958906,
      "mae_dx": 0.0007893923320807517,
      "mae_dy": 0.0013154896441847086,
      "pose_mae_dtheta": 0.04096631705760956,
      "pose_mae_dx": 0.010588913224637508,
      "pose_mae_dy": 0.018619241192936897,
      "pose_rmse_dtheta": 0.08338823914527893,
      "pose_rmse_dx": 0.026855824515223503,
      "pose_rmse_dy": 0.04188758507370949,
      "pose_rmse_mean": 0.05071055144071579,
      "rmse_dtheta": 0.01437387429177761,
      "rmse_dx": 0.0025007901713252068,
      "rmse_dy": 0.002799247158691287,
      "rmse_mean": 0.006557970307767391,
      "rotation_flip": 0.002254283055663109,
      "sparse_tokens": 32073.0,
      "step": 8705,
      "turn_loss": 0.04579320177435875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.404478721427244,
      "grad_norm": 0.5172883868217468,
      "learning_rate": 1.7810003693609634e-06,
      "loss": 0.0865,
      "mae_dtheta": 0.008822341449558735,
      "mae_dx": 0.0020603861194103956,
      "mae_dy": 0.0019950121641159058,
      "pose_mae_dtheta": 0.06360447406768799,
      "pose_mae_dx": 0.025292610749602318,
      "pose_mae_dy": 0.028178593143820763,
      "pose_rmse_dtheta": 0.1797366738319397,
      "pose_rmse_dx": 0.07873309403657913,
      "pose_rmse_dy": 0.08462195843458176,
      "pose_rmse_mean": 0.1143639087677002,
      "rmse_dtheta": 0.022887306287884712,
      "rmse_dx": 0.0061616674065589905,
      "rmse_dy": 0.005451977718621492,
      "rmse_mean": 0.011500317603349686,
      "rotation_flip": 0.005668398458510637,
      "sparse_tokens": 32089.0,
      "step": 8706,
      "turn_loss": 0.0912720263004303,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.4045251811930868,
      "grad_norm": 0.3922462463378906,
      "learning_rate": 1.7799887279557238e-06,
      "loss": 0.1041,
      "mae_dtheta": 0.02486605942249298,
      "mae_dx": 0.006270767655223608,
      "mae_dy": 0.004974568262696266,
      "pose_mae_dtheta": 0.19408676028251648,
      "pose_mae_dx": 0.043940432369709015,
      "pose_mae_dy": 0.07168029993772507,
      "pose_rmse_dtheta": 0.359346479177475,
      "pose_rmse_dx": 0.11608674377202988,
      "pose_rmse_dy": 0.18779133260250092,
      "pose_rmse_mean": 0.22107486426830292,
      "rmse_dtheta": 0.038961734622716904,
      "rmse_dx": 0.016751518473029137,
      "rmse_dy": 0.009506643749773502,
      "rmse_mean": 0.021739965304732323,
      "rotation_flip": 0.009960159659385681,
      "sparse_tokens": 15651.0,
      "step": 8707,
      "turn_loss": 0.20678766071796417,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40457164095892956,
      "grad_norm": 0.3839992582798004,
      "learning_rate": 1.7789773117275988e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.010028671473264694,
      "mae_dx": 0.0015903310850262642,
      "mae_dy": 0.002741314237937331,
      "pose_mae_dtheta": 0.07016617059707642,
      "pose_mae_dx": 0.019885698333382607,
      "pose_mae_dy": 0.027465401217341423,
      "pose_rmse_dtheta": 0.22144125401973724,
      "pose_rmse_dx": 0.051620110869407654,
      "pose_rmse_dy": 0.05846837908029556,
      "pose_rmse_mean": 0.11050991714000702,
      "rmse_dtheta": 0.02370556630194187,
      "rmse_dx": 0.004950145725160837,
      "rmse_dy": 0.006538176443427801,
      "rmse_mean": 0.011731295846402645,
      "rotation_flip": 0.005434782709926367,
      "sparse_tokens": 32105.0,
      "step": 8708,
      "turn_loss": 0.07641828805208206,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.40461810072477233,
      "grad_norm": 0.9868674278259277,
      "learning_rate": 1.777966120747321e-06,
      "loss": 0.2643,
      "mae_dtheta": 0.025043781846761703,
      "mae_dx": 0.0028505658265203238,
      "mae_dy": 0.004166306462138891,
      "pose_mae_dtheta": 0.2016584426164627,
      "pose_mae_dx": 0.04155932366847992,
      "pose_mae_dy": 0.06393849849700928,
      "pose_rmse_dtheta": 0.38661864399909973,
      "pose_rmse_dx": 0.09812715649604797,
      "pose_rmse_dy": 0.14442721009254456,
      "pose_rmse_mean": 0.20972435176372528,
      "rmse_dtheta": 0.043657053261995316,
      "rmse_dx": 0.007372134830802679,
      "rmse_dy": 0.008826592937111855,
      "rmse_mean": 0.01995192840695381,
      "rotation_flip": 0.007751937955617905,
      "sparse_tokens": 5470.0,
      "step": 8709,
      "turn_loss": 0.16616612672805786,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.4046645604906151,
      "grad_norm": 0.5771335959434509,
      "learning_rate": 1.7769551550856013e-06,
      "loss": 0.1522,
      "mae_dtheta": 0.03615487739443779,
      "mae_dx": 0.010428608395159245,
      "mae_dy": 0.00375609309412539,
      "pose_mae_dtheta": 0.30065128207206726,
      "pose_mae_dx": 0.08650586754083633,
      "pose_mae_dy": 0.05576251447200775,
      "pose_rmse_dtheta": 0.5295426249504089,
      "pose_rmse_dx": 0.19938473403453827,
      "pose_rmse_dy": 0.12667232751846313,
      "pose_rmse_mean": 0.285199910402298,
      "rmse_dtheta": 0.054902754724025726,
      "rmse_dx": 0.022155260667204857,
      "rmse_dy": 0.007590587250888348,
      "rmse_mean": 0.028216201812028885,
      "rotation_flip": 0.013274336233735085,
      "sparse_tokens": 14296.0,
      "step": 8710,
      "turn_loss": 0.23499470949172974,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.4047110202564579,
      "grad_norm": 0.47909674048423767,
      "learning_rate": 1.7759444148131361e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.028291309252381325,
      "mae_dx": 0.0026342985220253468,
      "mae_dy": 0.0028663137927651405,
      "pose_mae_dtheta": 0.20467589795589447,
      "pose_mae_dx": 0.020774325355887413,
      "pose_mae_dy": 0.02282877266407013,
      "pose_rmse_dtheta": 0.4375137686729431,
      "pose_rmse_dx": 0.048534195870161057,
      "pose_rmse_dy": 0.07846048474311829,
      "pose_rmse_mean": 0.1881694793701172,
      "rmse_dtheta": 0.05248667299747467,
      "rmse_dx": 0.006851722486317158,
      "rmse_dy": 0.007300158496946096,
      "rmse_mean": 0.02221285179257393,
      "rotation_flip": 0.0032051282469183207,
      "sparse_tokens": 6424.0,
      "step": 8711,
      "turn_loss": 0.2205052673816681,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.40475748002230066,
      "grad_norm": 0.8617443442344666,
      "learning_rate": 1.77493390000061e-06,
      "loss": 0.2231,
      "mae_dtheta": 0.03785262629389763,
      "mae_dx": 0.01180547010153532,
      "mae_dy": 0.008589783683419228,
      "pose_mae_dtheta": 0.25582289695739746,
      "pose_mae_dx": 0.0803772434592247,
      "pose_mae_dy": 0.09121859073638916,
      "pose_rmse_dtheta": 0.44121330976486206,
      "pose_rmse_dx": 0.16368062794208527,
      "pose_rmse_dy": 0.2297651171684265,
      "pose_rmse_mean": 0.27821969985961914,
      "rmse_dtheta": 0.053817737847566605,
      "rmse_dx": 0.02278381772339344,
      "rmse_dy": 0.01883314736187458,
      "rmse_mean": 0.03181156888604164,
      "rotation_flip": 0.014545454643666744,
      "sparse_tokens": 8882.0,
      "step": 8712,
      "turn_loss": 0.35660988092422485,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.40480393978814344,
      "grad_norm": 1.1453120708465576,
      "learning_rate": 1.7739236107186858e-06,
      "loss": 0.2503,
      "mae_dtheta": 0.03908458352088928,
      "mae_dx": 0.012182921171188354,
      "mae_dy": 0.00323925050906837,
      "pose_mae_dtheta": 0.33293500542640686,
      "pose_mae_dx": 0.09598519653081894,
      "pose_mae_dy": 0.0455150343477726,
      "pose_rmse_dtheta": 0.5666829943656921,
      "pose_rmse_dx": 0.21432456374168396,
      "pose_rmse_dy": 0.1245475634932518,
      "pose_rmse_mean": 0.30185168981552124,
      "rmse_dtheta": 0.05860722437500954,
      "rmse_dx": 0.024669433012604713,
      "rmse_dy": 0.007688065525144339,
      "rmse_mean": 0.030321575701236725,
      "rotation_flip": 0.012835472822189331,
      "sparse_tokens": 16023.0,
      "step": 8713,
      "turn_loss": 0.23100541532039642,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4048503995539863,
      "grad_norm": 0.46538659930229187,
      "learning_rate": 1.7729135470380154e-06,
      "loss": 0.1158,
      "mae_dtheta": 0.008619977161288261,
      "mae_dx": 0.0013728360645473003,
      "mae_dy": 0.002056310186162591,
      "pose_mae_dtheta": 0.05487927794456482,
      "pose_mae_dx": 0.01753065548837185,
      "pose_mae_dy": 0.026555215939879417,
      "pose_rmse_dtheta": 0.1125793382525444,
      "pose_rmse_dx": 0.04249811917543411,
      "pose_rmse_dy": 0.06837775558233261,
      "pose_rmse_mean": 0.07448507845401764,
      "rmse_dtheta": 0.017494406551122665,
      "rmse_dx": 0.003705537412315607,
      "rmse_dy": 0.004375337157398462,
      "rmse_mean": 0.008525094017386436,
      "rotation_flip": 0.008932039141654968,
      "sparse_tokens": 32089.0,
      "step": 8714,
      "turn_loss": 0.06262068450450897,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.40489685931982905,
      "grad_norm": 0.4462525248527527,
      "learning_rate": 1.771903709029234e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.008210240863263607,
      "mae_dx": 0.0014055671636015177,
      "mae_dy": 0.002292775083333254,
      "pose_mae_dtheta": 0.05649619176983833,
      "pose_mae_dx": 0.01865958794951439,
      "pose_mae_dy": 0.022150512784719467,
      "pose_rmse_dtheta": 0.16093315184116364,
      "pose_rmse_dx": 0.05106791853904724,
      "pose_rmse_dy": 0.05419888347387314,
      "pose_rmse_mean": 0.08873331546783447,
      "rmse_dtheta": 0.020247727632522583,
      "rmse_dx": 0.0037951585836708546,
      "rmse_dy": 0.005137104541063309,
      "rmse_mean": 0.009726664051413536,
      "rotation_flip": 0.003405704628676176,
      "sparse_tokens": 32089.0,
      "step": 8715,
      "turn_loss": 0.06284842640161514,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.4049433190856718,
      "grad_norm": 0.8219029903411865,
      "learning_rate": 1.7708940967629567e-06,
      "loss": 0.0761,
      "mae_dtheta": 0.024774571880698204,
      "mae_dx": 0.014325684867799282,
      "mae_dy": 0.0033352309837937355,
      "pose_mae_dtheta": 0.15826572477817535,
      "pose_mae_dx": 0.11917110532522202,
      "pose_mae_dy": 0.045730121433734894,
      "pose_rmse_dtheta": 0.3070768117904663,
      "pose_rmse_dx": 0.25442051887512207,
      "pose_rmse_dy": 0.10901197791099548,
      "pose_rmse_mean": 0.22350311279296875,
      "rmse_dtheta": 0.04275348782539368,
      "rmse_dx": 0.0277494415640831,
      "rmse_dy": 0.007039176300168037,
      "rmse_mean": 0.02584736794233322,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 5756.0,
      "step": 8716,
      "turn_loss": 0.15299004316329956,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.4049897788515146,
      "grad_norm": 0.5961180329322815,
      "learning_rate": 1.769884710309791e-06,
      "loss": 0.1911,
      "mae_dtheta": 0.012429126538336277,
      "mae_dx": 0.0014378351625055075,
      "mae_dy": 0.0027809515595436096,
      "pose_mae_dtheta": 0.08825090527534485,
      "pose_mae_dx": 0.026796089485287666,
      "pose_mae_dy": 0.03673156723380089,
      "pose_rmse_dtheta": 0.21835625171661377,
      "pose_rmse_dx": 0.07323194295167923,
      "pose_rmse_dy": 0.08158045262098312,
      "pose_rmse_mean": 0.12438955157995224,
      "rmse_dtheta": 0.026104120537638664,
      "rmse_dx": 0.004171822220087051,
      "rmse_dy": 0.005827922839671373,
      "rmse_mean": 0.012034622952342033,
      "rotation_flip": 0.002716336864978075,
      "sparse_tokens": 32025.0,
      "step": 8717,
      "turn_loss": 0.08027779310941696,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.4050362386173574,
      "grad_norm": 0.5384504795074463,
      "learning_rate": 1.7688755497403187e-06,
      "loss": 0.1383,
      "mae_dtheta": 0.0425199531018734,
      "mae_dx": 0.010936836712062359,
      "mae_dy": 0.006831902079284191,
      "pose_mae_dtheta": 0.345319002866745,
      "pose_mae_dx": 0.09709934145212173,
      "pose_mae_dy": 0.07719358056783676,
      "pose_rmse_dtheta": 0.6405450105667114,
      "pose_rmse_dx": 0.206319659948349,
      "pose_rmse_dy": 0.16835865378379822,
      "pose_rmse_mean": 0.33840781450271606,
      "rmse_dtheta": 0.06301027536392212,
      "rmse_dx": 0.02228662744164467,
      "rmse_dy": 0.013360315002501011,
      "rmse_mean": 0.03288573771715164,
      "rotation_flip": 0.011435831896960735,
      "sparse_tokens": 13178.0,
      "step": 8718,
      "turn_loss": 0.3577340543270111,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.40508269838320016,
      "grad_norm": 0.465544730424881,
      "learning_rate": 1.767866615125114e-06,
      "loss": 0.0882,
      "mae_dtheta": 0.01082705706357956,
      "mae_dx": 0.002335955621674657,
      "mae_dy": 0.002928605768829584,
      "pose_mae_dtheta": 0.0753115862607956,
      "pose_mae_dx": 0.02755468152463436,
      "pose_mae_dy": 0.02915116772055626,
      "pose_rmse_dtheta": 0.17616356909275055,
      "pose_rmse_dx": 0.08114171028137207,
      "pose_rmse_dy": 0.0690542533993721,
      "pose_rmse_mean": 0.10878650844097137,
      "rmse_dtheta": 0.022567039355635643,
      "rmse_dx": 0.00722239725291729,
      "rmse_dy": 0.007190894801169634,
      "rmse_mean": 0.01232677698135376,
      "rotation_flip": 0.0041771093383431435,
      "sparse_tokens": 32073.0,
      "step": 8719,
      "turn_loss": 0.09259991347789764,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40512915814904293,
      "grad_norm": 0.40746167302131653,
      "learning_rate": 1.7668579065347335e-06,
      "loss": 0.0772,
      "mae_dtheta": 0.007391955237835646,
      "mae_dx": 0.0018740837695077062,
      "mae_dy": 0.002081790007650852,
      "pose_mae_dtheta": 0.04936676844954491,
      "pose_mae_dx": 0.017596041783690453,
      "pose_mae_dy": 0.01976710744202137,
      "pose_rmse_dtheta": 0.14508163928985596,
      "pose_rmse_dx": 0.04957468807697296,
      "pose_rmse_dy": 0.04789749160408974,
      "pose_rmse_mean": 0.08085127174854279,
      "rmse_dtheta": 0.019290093332529068,
      "rmse_dx": 0.005281006917357445,
      "rmse_dy": 0.0050545730628073215,
      "rmse_mean": 0.009875224903225899,
      "rotation_flip": 0.0037095919251441956,
      "sparse_tokens": 32105.0,
      "step": 8720,
      "turn_loss": 0.07188960164785385,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.4051756179148857,
      "grad_norm": 0.458518385887146,
      "learning_rate": 1.7658494240397127e-06,
      "loss": 0.0973,
      "mae_dtheta": 0.028180329129099846,
      "mae_dx": 0.010571746155619621,
      "mae_dy": 0.0025506620295345783,
      "pose_mae_dtheta": 0.1901637762784958,
      "pose_mae_dx": 0.09101757407188416,
      "pose_mae_dy": 0.026789255440235138,
      "pose_rmse_dtheta": 0.35943761467933655,
      "pose_rmse_dx": 0.23803308606147766,
      "pose_rmse_dy": 0.05689486116170883,
      "pose_rmse_mean": 0.21812185645103455,
      "rmse_dtheta": 0.046193599700927734,
      "rmse_dx": 0.024285467341542244,
      "rmse_dy": 0.005456116050481796,
      "rmse_mean": 0.025311728939414024,
      "rotation_flip": 0.016949152573943138,
      "sparse_tokens": 5133.0,
      "step": 8721,
      "turn_loss": 0.26635727286338806,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 31046.0,
      "epoch": 0.4052220776807285,
      "grad_norm": 0.4585752487182617,
      "learning_rate": 1.7648411677105797e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.03021734207868576,
      "mae_dx": 0.012494619004428387,
      "mae_dy": 0.004114534240216017,
      "pose_mae_dtheta": 0.24063445627689362,
      "pose_mae_dx": 0.10242372751235962,
      "pose_mae_dy": 0.053372811526060104,
      "pose_rmse_dtheta": 0.4506753385066986,
      "pose_rmse_dx": 0.23706649243831635,
      "pose_rmse_dy": 0.14927318692207336,
      "pose_rmse_mean": 0.2790050208568573,
      "rmse_dtheta": 0.04810502007603645,
      "rmse_dx": 0.026422955095767975,
      "rmse_dy": 0.009255408309400082,
      "rmse_mean": 0.02792779728770256,
      "rotation_flip": 0.007552870083600283,
      "sparse_tokens": 25378.0,
      "step": 8722,
      "turn_loss": 0.230041965842247,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40526853744657126,
      "grad_norm": 0.4519418478012085,
      "learning_rate": 1.7638331376178385e-06,
      "loss": 0.0932,
      "mae_dtheta": 0.012779871001839638,
      "mae_dx": 0.002103600185364485,
      "mae_dy": 0.003980174195021391,
      "pose_mae_dtheta": 0.080316923558712,
      "pose_mae_dx": 0.03186306729912758,
      "pose_mae_dy": 0.040364161133766174,
      "pose_rmse_dtheta": 0.15681718289852142,
      "pose_rmse_dx": 0.07571982592344284,
      "pose_rmse_dy": 0.09418801963329315,
      "pose_rmse_mean": 0.10890834033489227,
      "rmse_dtheta": 0.024553507566452026,
      "rmse_dx": 0.00557687459513545,
      "rmse_dy": 0.008233364671468735,
      "rmse_mean": 0.012787915766239166,
      "rotation_flip": 0.006788866128772497,
      "sparse_tokens": 32105.0,
      "step": 8723,
      "turn_loss": 0.1203787624835968,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40531499721241404,
      "grad_norm": 0.31180521845817566,
      "learning_rate": 1.7628253338319845e-06,
      "loss": 0.0669,
      "mae_dtheta": 0.007508017588406801,
      "mae_dx": 0.0009120235336013138,
      "mae_dy": 0.0014358797343447804,
      "pose_mae_dtheta": 0.05517452582716942,
      "pose_mae_dx": 0.012280220165848732,
      "pose_mae_dy": 0.019528938457369804,
      "pose_rmse_dtheta": 0.1959347426891327,
      "pose_rmse_dx": 0.03661595657467842,
      "pose_rmse_dy": 0.053733501583337784,
      "pose_rmse_mean": 0.09542807191610336,
      "rmse_dtheta": 0.020565815269947052,
      "rmse_dx": 0.0030386282596737146,
      "rmse_dy": 0.003618368413299322,
      "rmse_mean": 0.009074270725250244,
      "rotation_flip": 0.003173164092004299,
      "sparse_tokens": 32105.0,
      "step": 8724,
      "turn_loss": 0.061362627893686295,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.4053614569782568,
      "grad_norm": 0.44538602232933044,
      "learning_rate": 1.7618177564234907e-06,
      "loss": 0.1042,
      "mae_dtheta": 0.02793177403509617,
      "mae_dx": 0.015031138435006142,
      "mae_dy": 0.003915517590939999,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44538605213165283,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.55862426757812,
      "model/head/act_norm_mean": 108.61633831521739,
      "model/head/act_norm_min": 68.94112396240234,
      "model/head/act_over_embed": 74.64216457239795,
      "model/head/grad_frac": 0.09586464613676071,
      "model/head/grad_norm": 0.04269677773118019,
      "model/head/grad_zero_frac": 0.00019829485972877592,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6875424592391305,
      "model/head/update_ratio": 0.0007271687500178814,
      "model/head/weight_delta": 9.818021774291992,
      "model/head/weight_delta_rel": 0.17223718762397766,
      "model/head/weight_norm": 58.71646499633789,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4224841594696045,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42241513388497487,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42234402894973755,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2902876347185457,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0945000946521759,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04208902269601822,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5491629464285714,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001359113142825663,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1219403743743896,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10200352221727371,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96800422668457,
      "model/modality_embedder/grad_frac": 0.0945000946521759,
      "model/modality_embedder/grad_norm": 0.04208902269601822,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5491629464285714,
      "model/modality_embedder/update_ratio": 0.001359113142825663,
      "model/modality_embedder/weight_delta": 3.1219403743743896,
      "model/modality_embedder/weight_delta_rel": 0.10200352221727371,
      "model/modality_embedder/weight_norm": 30.96800422668457,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.5478515625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.4410297331493,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.136630058288574,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.108895090998185,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06774387508630753,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.030172176659107208,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010798120638355613,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6576504707336426,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09684638679027557,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.94206428527832,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.38871002197266,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.260418463883138,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.409120559692383,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.671986697996637,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06967595964670181,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.031032700091600418,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010434613795951009,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3693127632141113,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11671562492847443,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.740150451660156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.96141052246094,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.908730158730158,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.624311447143555,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.804721926432727,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07037188857793808,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03134265914559364,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010206224396824837,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6454014778137207,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1224057525396347,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.7093563079834,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.79983520507812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.74552493098689,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.618946075439453,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.066984490271143,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08351761847734451,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03719758242368698,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012428141199052334,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1275529861450195,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1068849191069603,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.930126190185547,
      "model/normalizer/grad_frac": 0.270990788936615,
      "model/normalizer/grad_norm": 0.12069552391767502,
      "model/normalizer/grad_zero_frac": 0.00019144162070006132,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001535107847303152,
      "model/normalizer/weight_delta": 6.590876579284668,
      "model/normalizer/weight_delta_rel": 0.08488667756319046,
      "model/normalizer/weight_norm": 78.62348175048828,
      "pose_mae_dtheta": 0.2056078165769577,
      "pose_mae_dx": 0.13149119913578033,
      "pose_mae_dy": 0.04890785366296768,
      "pose_rmse_dtheta": 0.3618563115596771,
      "pose_rmse_dx": 0.2792465388774872,
      "pose_rmse_dy": 0.11748761683702469,
      "pose_rmse_mean": 0.25286349654197693,
      "rmse_dtheta": 0.04399440437555313,
      "rmse_dx": 0.02844114601612091,
      "rmse_dy": 0.00731066195294261,
      "rmse_mean": 0.02658206969499588,
      "rotation_flip": 0.0062500000931322575,
      "sparse_tokens": 18156.0,
      "step": 8725,
      "turn_loss": 0.27760106325149536,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4054079167440996,
      "grad_norm": 0.5442683696746826,
      "learning_rate": 1.7608104054628195e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.0071988096460700035,
      "mae_dx": 0.0013059050543233752,
      "mae_dy": 0.0013969670981168747,
      "pose_mae_dtheta": 0.04854447394609451,
      "pose_mae_dx": 0.017501182854175568,
      "pose_mae_dy": 0.018094651401042938,
      "pose_rmse_dtheta": 0.13689398765563965,
      "pose_rmse_dx": 0.06503758579492569,
      "pose_rmse_dy": 0.05140131339430809,
      "pose_rmse_mean": 0.08444429934024811,
      "rmse_dtheta": 0.018188316375017166,
      "rmse_dx": 0.005428896751254797,
      "rmse_dy": 0.0039414092898368835,
      "rmse_mean": 0.009186208248138428,
      "rotation_flip": 0.0005652911495417356,
      "sparse_tokens": 32041.0,
      "step": 8726,
      "turn_loss": 0.05269818753004074,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.40545437650994237,
      "grad_norm": 0.4984699785709381,
      "learning_rate": 1.7598032810204163e-06,
      "loss": 0.0627,
      "mae_dtheta": 0.029820693656802177,
      "mae_dx": 0.011731275357306004,
      "mae_dy": 0.0024290969595313072,
      "pose_mae_dtheta": 0.20624102652072906,
      "pose_mae_dx": 0.10807003825902939,
      "pose_mae_dy": 0.032298143953084946,
      "pose_rmse_dtheta": 0.3746083974838257,
      "pose_rmse_dx": 0.23485904932022095,
      "pose_rmse_dy": 0.07192239910364151,
      "pose_rmse_mean": 0.2271299660205841,
      "rmse_dtheta": 0.04936943203210831,
      "rmse_dx": 0.02438897266983986,
      "rmse_dy": 0.004969783127307892,
      "rmse_mean": 0.026242731139063835,
      "rotation_flip": 0.007766990456730127,
      "sparse_tokens": 7753.0,
      "step": 8727,
      "turn_loss": 0.2303338497877121,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.40550083627578515,
      "grad_norm": 0.5023476481437683,
      "learning_rate": 1.7587963831667076e-06,
      "loss": 0.0714,
      "mae_dtheta": 0.03134100139141083,
      "mae_dx": 0.0118767274543643,
      "mae_dy": 0.007098680827766657,
      "pose_mae_dtheta": 0.20125094056129456,
      "pose_mae_dx": 0.10206960886716843,
      "pose_mae_dy": 0.08476243168115616,
      "pose_rmse_dtheta": 0.3861362040042877,
      "pose_rmse_dx": 0.22795893251895905,
      "pose_rmse_dy": 0.190242737531662,
      "pose_rmse_mean": 0.2681126296520233,
      "rmse_dtheta": 0.05005808174610138,
      "rmse_dx": 0.025694850832223892,
      "rmse_dy": 0.015430975705385208,
      "rmse_mean": 0.03039463423192501,
      "rotation_flip": 0.019607843831181526,
      "sparse_tokens": 7383.0,
      "step": 8728,
      "turn_loss": 0.25771158933639526,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4055472960416279,
      "grad_norm": 0.7929087281227112,
      "learning_rate": 1.7577897119721094e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.011384328827261925,
      "mae_dx": 0.0020054413471370935,
      "mae_dy": 0.0030479752458631992,
      "pose_mae_dtheta": 0.07833416759967804,
      "pose_mae_dx": 0.023405831307172775,
      "pose_mae_dy": 0.028616994619369507,
      "pose_rmse_dtheta": 0.20608261227607727,
      "pose_rmse_dx": 0.07055004686117172,
      "pose_rmse_dy": 0.06995552033185959,
      "pose_rmse_mean": 0.11552940309047699,
      "rmse_dtheta": 0.026588808745145798,
      "rmse_dx": 0.0066810655407607555,
      "rmse_dy": 0.007554024923592806,
      "rmse_mean": 0.013607966713607311,
      "rotation_flip": 0.003991130739450455,
      "sparse_tokens": 32041.0,
      "step": 8729,
      "turn_loss": 0.09507051855325699,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.40559375580747076,
      "grad_norm": 0.4849386215209961,
      "learning_rate": 1.7567832675070145e-06,
      "loss": 0.1245,
      "mae_dtheta": 0.007841023616492748,
      "mae_dx": 0.0010355876293033361,
      "mae_dy": 0.0019595583435148,
      "pose_mae_dtheta": 0.049812138080596924,
      "pose_mae_dx": 0.015692589804530144,
      "pose_mae_dy": 0.021156776696443558,
      "pose_rmse_dtheta": 0.12190204858779907,
      "pose_rmse_dx": 0.038634292781353,
      "pose_rmse_dy": 0.05020727962255478,
      "pose_rmse_mean": 0.07024788111448288,
      "rmse_dtheta": 0.019229596480727196,
      "rmse_dx": 0.0025778552517294884,
      "rmse_dy": 0.004175612237304449,
      "rmse_mean": 0.00866102147847414,
      "rotation_flip": 0.004051863681524992,
      "sparse_tokens": 32073.0,
      "step": 8730,
      "turn_loss": 0.0653069019317627,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.40564021557331353,
      "grad_norm": 0.5534316897392273,
      "learning_rate": 1.7557770498418087e-06,
      "loss": 0.1163,
      "mae_dtheta": 0.05521586537361145,
      "mae_dx": 0.017459038645029068,
      "mae_dy": 0.006575425621122122,
      "pose_mae_dtheta": 0.4784930646419525,
      "pose_mae_dx": 0.12798623740673065,
      "pose_mae_dy": 0.08777675777673721,
      "pose_rmse_dtheta": 0.7860471606254578,
      "pose_rmse_dx": 0.29866597056388855,
      "pose_rmse_dy": 0.18546827137470245,
      "pose_rmse_mean": 0.4233938157558441,
      "rmse_dtheta": 0.07791101187467575,
      "rmse_dx": 0.03333079442381859,
      "rmse_dy": 0.01055186614394188,
      "rmse_mean": 0.04059789329767227,
      "rotation_flip": 0.016129031777381897,
      "sparse_tokens": 4410.0,
      "step": 8731,
      "turn_loss": 0.353370726108551,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4056866753391563,
      "grad_norm": 0.5313317179679871,
      "learning_rate": 1.754771059046853e-06,
      "loss": 0.0797,
      "mae_dtheta": 0.008541091345250607,
      "mae_dx": 0.0020848973654210567,
      "mae_dy": 0.0026320519391447306,
      "pose_mae_dtheta": 0.060271188616752625,
      "pose_mae_dx": 0.023947518318891525,
      "pose_mae_dy": 0.018882883712649345,
      "pose_rmse_dtheta": 0.1992310881614685,
      "pose_rmse_dx": 0.07174739986658096,
      "pose_rmse_dy": 0.05031721293926239,
      "pose_rmse_mean": 0.10709856450557709,
      "rmse_dtheta": 0.02267369255423546,
      "rmse_dx": 0.005006671417504549,
      "rmse_dy": 0.006784119177609682,
      "rmse_mean": 0.01148816104978323,
      "rotation_flip": 0.00360721442848444,
      "sparse_tokens": 32169.0,
      "step": 8732,
      "turn_loss": 0.08028996735811234,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.4057331351049991,
      "grad_norm": 0.35154688358306885,
      "learning_rate": 1.7537652951924993e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.03360412269830704,
      "mae_dx": 0.011978214606642723,
      "mae_dy": 0.005668476223945618,
      "pose_mae_dtheta": 0.2547653913497925,
      "pose_mae_dx": 0.09330378472805023,
      "pose_mae_dy": 0.07274391502141953,
      "pose_rmse_dtheta": 0.425525963306427,
      "pose_rmse_dx": 0.21967804431915283,
      "pose_rmse_dy": 0.16532854735851288,
      "pose_rmse_mean": 0.27017754316329956,
      "rmse_dtheta": 0.049251433461904526,
      "rmse_dx": 0.025019405409693718,
      "rmse_dy": 0.012586923316121101,
      "rmse_mean": 0.02895258739590645,
      "rotation_flip": 0.015741508454084396,
      "sparse_tokens": 22618.0,
      "step": 8733,
      "turn_loss": 0.24586008489131927,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.40577959487084186,
      "grad_norm": 0.4462798535823822,
      "learning_rate": 1.7527597583490825e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.03398158773779869,
      "mae_dx": 0.016235480085015297,
      "mae_dy": 0.006644358392804861,
      "pose_mae_dtheta": 0.25950291752815247,
      "pose_mae_dx": 0.12550580501556396,
      "pose_mae_dy": 0.0804404765367508,
      "pose_rmse_dtheta": 0.49099868535995483,
      "pose_rmse_dx": 0.27441197633743286,
      "pose_rmse_dy": 0.2392200231552124,
      "pose_rmse_mean": 0.3348768949508667,
      "rmse_dtheta": 0.053267449140548706,
      "rmse_dx": 0.030894668772816658,
      "rmse_dy": 0.01644713059067726,
      "rmse_mean": 0.03353641554713249,
      "rotation_flip": 0.0064575644209980965,
      "sparse_tokens": 21186.0,
      "step": 8734,
      "turn_loss": 0.2763902544975281,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.40582605463668464,
      "grad_norm": 0.34509769082069397,
      "learning_rate": 1.7517544485869164e-06,
      "loss": 0.0573,
      "mae_dtheta": 0.008248863741755486,
      "mae_dx": 0.0013055370654910803,
      "mae_dy": 0.001462440937757492,
      "pose_mae_dtheta": 0.05384784936904907,
      "pose_mae_dx": 0.014983291737735271,
      "pose_mae_dy": 0.016371645033359528,
      "pose_rmse_dtheta": 0.19106091558933258,
      "pose_rmse_dx": 0.04695993289351463,
      "pose_rmse_dy": 0.05844904109835625,
      "pose_rmse_mean": 0.09882330149412155,
      "rmse_dtheta": 0.023926299065351486,
      "rmse_dx": 0.003734125290066004,
      "rmse_dy": 0.0049742842093110085,
      "rmse_mean": 0.010878236964344978,
      "rotation_flip": 0.006353861186653376,
      "sparse_tokens": 32153.0,
      "step": 8735,
      "turn_loss": 0.05405474081635475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4058725144025274,
      "grad_norm": 0.3841893672943115,
      "learning_rate": 1.7507493659763076e-06,
      "loss": 0.0798,
      "mae_dtheta": 0.008192358538508415,
      "mae_dx": 0.0008025021525099874,
      "mae_dy": 0.0013850332470610738,
      "pose_mae_dtheta": 0.05534585192799568,
      "pose_mae_dx": 0.01103584747761488,
      "pose_mae_dy": 0.017486704513430595,
      "pose_rmse_dtheta": 0.1811232566833496,
      "pose_rmse_dx": 0.027128107845783234,
      "pose_rmse_dy": 0.041104260832071304,
      "pose_rmse_mean": 0.08311854302883148,
      "rmse_dtheta": 0.02181190811097622,
      "rmse_dx": 0.0024296038318425417,
      "rmse_dy": 0.003369176760315895,
      "rmse_mean": 0.009203563444316387,
      "rotation_flip": 0.0023800078779459,
      "sparse_tokens": 32105.0,
      "step": 8736,
      "turn_loss": 0.051144301891326904,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.4059189741683702,
      "grad_norm": 0.48356860876083374,
      "learning_rate": 1.7497445105875377e-06,
      "loss": 0.1238,
      "mae_dtheta": 0.036602847278118134,
      "mae_dx": 0.013420718722045422,
      "mae_dy": 0.004823589231818914,
      "pose_mae_dtheta": 0.3023061752319336,
      "pose_mae_dx": 0.09607915580272675,
      "pose_mae_dy": 0.047190383076667786,
      "pose_rmse_dtheta": 0.5040708184242249,
      "pose_rmse_dx": 0.20485816895961761,
      "pose_rmse_dy": 0.11244238913059235,
      "pose_rmse_mean": 0.27379047870635986,
      "rmse_dtheta": 0.05469152331352234,
      "rmse_dx": 0.0260485652834177,
      "rmse_dy": 0.010547414422035217,
      "rmse_mean": 0.030429167672991753,
      "rotation_flip": 0.018944520503282547,
      "sparse_tokens": 11763.0,
      "step": 8737,
      "turn_loss": 0.2719391882419586,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.40596543393421297,
      "grad_norm": 0.4501653015613556,
      "learning_rate": 1.7487398824908786e-06,
      "loss": 0.1352,
      "mae_dtheta": 0.026609214022755623,
      "mae_dx": 0.00895601138472557,
      "mae_dy": 0.004175987094640732,
      "pose_mae_dtheta": 0.22743894159793854,
      "pose_mae_dx": 0.07168528437614441,
      "pose_mae_dy": 0.04190101474523544,
      "pose_rmse_dtheta": 0.4381258487701416,
      "pose_rmse_dx": 0.1681763231754303,
      "pose_rmse_dy": 0.09481055289506912,
      "pose_rmse_mean": 0.23370423913002014,
      "rmse_dtheta": 0.04374350234866142,
      "rmse_dx": 0.0207050871104002,
      "rmse_dy": 0.008350216783583164,
      "rmse_mean": 0.02426626905798912,
      "rotation_flip": 0.01505174022167921,
      "sparse_tokens": 18027.0,
      "step": 8738,
      "turn_loss": 0.22911401093006134,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.40601189370005575,
      "grad_norm": 0.5419828295707703,
      "learning_rate": 1.7477354817565862e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.00529850460588932,
      "mae_dx": 0.001176095916889608,
      "mae_dy": 0.000580323045141995,
      "pose_mae_dtheta": 0.039547137916088104,
      "pose_mae_dx": 0.009975788183510303,
      "pose_mae_dy": 0.008664332330226898,
      "pose_rmse_dtheta": 0.13261355459690094,
      "pose_rmse_dx": 0.028244322165846825,
      "pose_rmse_dy": 0.02877374179661274,
      "pose_rmse_mean": 0.06321053951978683,
      "rmse_dtheta": 0.018653130158782005,
      "rmse_dx": 0.0039118253625929356,
      "rmse_dy": 0.0018726314883679152,
      "rmse_mean": 0.008145862258970737,
      "rotation_flip": 0.0006501950556412339,
      "sparse_tokens": 32137.0,
      "step": 8739,
      "turn_loss": 0.044321607798337936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.4060583534658985,
      "grad_norm": 0.7934407591819763,
      "learning_rate": 1.7467313084548959e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.029481658712029457,
      "mae_dx": 0.007791423704475164,
      "mae_dy": 0.005176146514713764,
      "pose_mae_dtheta": 0.21186336874961853,
      "pose_mae_dx": 0.05892620235681534,
      "pose_mae_dy": 0.06426719576120377,
      "pose_rmse_dtheta": 0.363711416721344,
      "pose_rmse_dx": 0.11928078532218933,
      "pose_rmse_dy": 0.14542323350906372,
      "pose_rmse_mean": 0.20947182178497314,
      "rmse_dtheta": 0.045927807688713074,
      "rmse_dx": 0.017481183633208275,
      "rmse_dy": 0.009715255349874496,
      "rmse_mean": 0.02437474951148033,
      "rotation_flip": 0.016073478385806084,
      "sparse_tokens": 15933.0,
      "step": 8740,
      "turn_loss": 0.21372497081756592,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4061048132317413,
      "grad_norm": 0.563520610332489,
      "learning_rate": 1.7457273626560328e-06,
      "loss": 0.1544,
      "mae_dtheta": 0.007271557580679655,
      "mae_dx": 0.00203905557282269,
      "mae_dy": 0.0032457979395985603,
      "pose_mae_dtheta": 0.047194384038448334,
      "pose_mae_dx": 0.025806725025177002,
      "pose_mae_dy": 0.02645944245159626,
      "pose_rmse_dtheta": 0.09066039323806763,
      "pose_rmse_dx": 0.07995252311229706,
      "pose_rmse_dy": 0.05842042341828346,
      "pose_rmse_mean": 0.07634444534778595,
      "rmse_dtheta": 0.0145693589001894,
      "rmse_dx": 0.005069904029369354,
      "rmse_dy": 0.00720664206892252,
      "rmse_mean": 0.008948635309934616,
      "rotation_flip": 0.004694835748523474,
      "sparse_tokens": 32105.0,
      "step": 8741,
      "turn_loss": 0.07340415567159653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.4061512729975841,
      "grad_norm": 1.3908298015594482,
      "learning_rate": 1.7447236444302002e-06,
      "loss": 0.2783,
      "mae_dtheta": 0.03496473655104637,
      "mae_dx": 0.009144552052021027,
      "mae_dy": 0.005355875939130783,
      "pose_mae_dtheta": 0.24100609123706818,
      "pose_mae_dx": 0.07752024382352829,
      "pose_mae_dy": 0.04923095926642418,
      "pose_rmse_dtheta": 0.47353801131248474,
      "pose_rmse_dx": 0.19050109386444092,
      "pose_rmse_dy": 0.14161187410354614,
      "pose_rmse_mean": 0.2685503363609314,
      "rmse_dtheta": 0.056957684457302094,
      "rmse_dx": 0.021086333319544792,
      "rmse_dy": 0.01181144267320633,
      "rmse_mean": 0.029951822012662888,
      "rotation_flip": 0.01589404046535492,
      "sparse_tokens": 13136.0,
      "step": 8742,
      "turn_loss": 0.2652929723262787,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.40619773276342686,
      "grad_norm": 0.5718671679496765,
      "learning_rate": 1.7437201538475916e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.024747466668486595,
      "mae_dx": 0.009702657349407673,
      "mae_dy": 0.0019158137729391456,
      "pose_mae_dtheta": 0.18737851083278656,
      "pose_mae_dx": 0.072472482919693,
      "pose_mae_dy": 0.029280193150043488,
      "pose_rmse_dtheta": 0.35793155431747437,
      "pose_rmse_dx": 0.20817573368549347,
      "pose_rmse_dy": 0.08412788808345795,
      "pose_rmse_mean": 0.216745063662529,
      "rmse_dtheta": 0.04267941787838936,
      "rmse_dx": 0.022547492757439613,
      "rmse_dy": 0.004769541788846254,
      "rmse_mean": 0.023332152515649796,
      "rotation_flip": 0.007838745601475239,
      "sparse_tokens": 17031.0,
      "step": 8743,
      "turn_loss": 0.16996072232723236,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.40624419252926963,
      "grad_norm": 0.7177836298942566,
      "learning_rate": 1.7427168909783793e-06,
      "loss": 0.2087,
      "mae_dtheta": 0.03928721323609352,
      "mae_dx": 0.014011140912771225,
      "mae_dy": 0.008896864019334316,
      "pose_mae_dtheta": 0.30742794275283813,
      "pose_mae_dx": 0.11930926889181137,
      "pose_mae_dy": 0.07819467782974243,
      "pose_rmse_dtheta": 0.5141085386276245,
      "pose_rmse_dx": 0.24762418866157532,
      "pose_rmse_dy": 0.16835327446460724,
      "pose_rmse_mean": 0.31002867221832275,
      "rmse_dtheta": 0.056430064141750336,
      "rmse_dx": 0.025590570643544197,
      "rmse_dy": 0.017336124554276466,
      "rmse_mean": 0.03311891853809357,
      "rotation_flip": 0.01458173431456089,
      "sparse_tokens": 21692.0,
      "step": 8744,
      "turn_loss": 0.3453308641910553,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4062906522951124,
      "grad_norm": 0.5079665780067444,
      "learning_rate": 1.7417138558927244e-06,
      "loss": 0.0773,
      "mae_dtheta": 0.010841179639101028,
      "mae_dx": 0.001785953645594418,
      "mae_dy": 0.002689676359295845,
      "pose_mae_dtheta": 0.07954887300729752,
      "pose_mae_dx": 0.023171525448560715,
      "pose_mae_dy": 0.025592733174562454,
      "pose_rmse_dtheta": 0.2541095018386841,
      "pose_rmse_dx": 0.06886382400989532,
      "pose_rmse_dy": 0.08814176172018051,
      "pose_rmse_mean": 0.13703836500644684,
      "rmse_dtheta": 0.028232602402567863,
      "rmse_dx": 0.006404772400856018,
      "rmse_dy": 0.006937716621905565,
      "rmse_mean": 0.013858364894986153,
      "rotation_flip": 0.006038647145032883,
      "sparse_tokens": 32105.0,
      "step": 8745,
      "turn_loss": 0.07912324368953705,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4063371120609552,
      "grad_norm": 0.627557635307312,
      "learning_rate": 1.740711048660767e-06,
      "loss": 0.0954,
      "mae_dtheta": 0.012129455804824829,
      "mae_dx": 0.00423651235178113,
      "mae_dy": 0.00370225147344172,
      "pose_mae_dtheta": 0.0850510373711586,
      "pose_mae_dx": 0.03178844973444939,
      "pose_mae_dy": 0.0442122183740139,
      "pose_rmse_dtheta": 0.22475838661193848,
      "pose_rmse_dx": 0.09289678931236267,
      "pose_rmse_dy": 0.13287895917892456,
      "pose_rmse_mean": 0.15017804503440857,
      "rmse_dtheta": 0.02808462269604206,
      "rmse_dx": 0.01404400635510683,
      "rmse_dy": 0.010587889701128006,
      "rmse_mean": 0.017572173848748207,
      "rotation_flip": 0.007366482634097338,
      "sparse_tokens": 32057.0,
      "step": 8746,
      "turn_loss": 0.11842990666627884,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.406383571826798,
      "grad_norm": 0.6309831738471985,
      "learning_rate": 1.7397084693526367e-06,
      "loss": 0.147,
      "mae_dtheta": 0.036898959428071976,
      "mae_dx": 0.009989961981773376,
      "mae_dy": 0.002687940839678049,
      "pose_mae_dtheta": 0.28588762879371643,
      "pose_mae_dx": 0.07427607476711273,
      "pose_mae_dy": 0.02653561905026436,
      "pose_rmse_dtheta": 0.4981619715690613,
      "pose_rmse_dx": 0.17816852033138275,
      "pose_rmse_dy": 0.06432455778121948,
      "pose_rmse_mean": 0.2468850314617157,
      "rmse_dtheta": 0.05555829405784607,
      "rmse_dx": 0.021849486976861954,
      "rmse_dy": 0.007017212454229593,
      "rmse_mean": 0.02814166247844696,
      "rotation_flip": 0.017621144652366638,
      "sparse_tokens": 12316.0,
      "step": 8747,
      "turn_loss": 0.2670632600784302,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4064300315926408,
      "grad_norm": 0.43561601638793945,
      "learning_rate": 1.7387061180384434e-06,
      "loss": 0.0701,
      "mae_dtheta": 0.008340466767549515,
      "mae_dx": 0.001765836146660149,
      "mae_dy": 0.0016535806935280561,
      "pose_mae_dtheta": 0.05805106461048126,
      "pose_mae_dx": 0.020377857610583305,
      "pose_mae_dy": 0.022909637540578842,
      "pose_rmse_dtheta": 0.13947881758213043,
      "pose_rmse_dx": 0.06350759416818619,
      "pose_rmse_dy": 0.054006800055503845,
      "pose_rmse_mean": 0.08566441386938095,
      "rmse_dtheta": 0.018141726031899452,
      "rmse_dx": 0.006362016778439283,
      "rmse_dy": 0.003821160877123475,
      "rmse_mean": 0.009441634640097618,
      "rotation_flip": 0.0023562677670270205,
      "sparse_tokens": 32073.0,
      "step": 8748,
      "turn_loss": 0.06383375078439713,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.40647649135848357,
      "grad_norm": 0.5351736545562744,
      "learning_rate": 1.7377039947882802e-06,
      "loss": 0.119,
      "mae_dtheta": 0.009556368924677372,
      "mae_dx": 0.0024400767870247364,
      "mae_dy": 0.0034890342503786087,
      "pose_mae_dtheta": 0.05978202074766159,
      "pose_mae_dx": 0.026402993127703667,
      "pose_mae_dy": 0.029440488666296005,
      "pose_rmse_dtheta": 0.13032354414463043,
      "pose_rmse_dx": 0.064827561378479,
      "pose_rmse_dy": 0.06179090216755867,
      "pose_rmse_mean": 0.0856473371386528,
      "rmse_dtheta": 0.02023983746767044,
      "rmse_dx": 0.006629021372646093,
      "rmse_dy": 0.008029917255043983,
      "rmse_mean": 0.01163292583078146,
      "rotation_flip": 0.008946321904659271,
      "sparse_tokens": 32137.0,
      "step": 8749,
      "turn_loss": 0.10378728061914444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.40652295112432635,
      "grad_norm": 0.5974733829498291,
      "learning_rate": 1.736702099672229e-06,
      "loss": 0.1852,
      "mae_dtheta": 0.025841455906629562,
      "mae_dx": 0.006576382089406252,
      "mae_dy": 0.005195774603635073,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5974733829498291,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 146.28953552246094,
      "model/head/act_norm_mean": 107.97240179357394,
      "model/head/act_norm_min": 60.09526824951172,
      "model/head/act_over_embed": 74.19964536609587,
      "model/head/grad_frac": 0.11653560400009155,
      "model/head/grad_norm": 0.06962691992521286,
      "model/head/grad_zero_frac": 0.00016783676983322948,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6954775528169014,
      "model/head/update_ratio": 0.0011857968056574464,
      "model/head/weight_delta": 9.821785926818848,
      "model/head/weight_delta_rel": 0.1723032146692276,
      "model/head/weight_norm": 58.717411041259766,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42238590121269226,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42238590121269226,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42238590121269226,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2902675457524725,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09832409024238586,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05874602869153023,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0018969769589602947,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1242101192474365,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10207768529653549,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96823501586914,
      "model/modality_embedder/grad_frac": 0.09832409024238586,
      "model/modality_embedder/grad_norm": 0.05874602869153023,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0018969769589602947,
      "model/modality_embedder/weight_delta": 3.1242101192474365,
      "model/modality_embedder/weight_delta_rel": 0.10207768529653549,
      "model/modality_embedder/weight_norm": 30.96823501586914,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 83.6610107421875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.40883146098815,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.140460014343262,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.086768136924068,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07604093104600906,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0454324334859848,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001625920063816011,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.659562110900879,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09691604971885681,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.94260025024414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.93600463867188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.193017479879277,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.493167877197266,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.62566811077123,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07862669974565506,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04697735980153084,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015795581275597215,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.371555805206299,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11679332703351974,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.74082374572754,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.30003356933594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.792126020008943,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.511470794677734,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.72459047063836,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0861193835735321,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05145404115319252,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016754838870838284,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6478381156921387,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12248757481575012,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.709959030151367,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.87973022460938,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.633039556785157,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.537056922912598,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.989683488015046,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08675946295261383,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05183647200465202,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001731881289742887,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1301610469818115,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1069740504026413,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.93073081970215,
      "model/normalizer/grad_frac": 0.326878160238266,
      "model/normalizer/grad_norm": 0.19530099630355835,
      "model/normalizer/grad_zero_frac": 0.0001949868310475722,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002483977470546961,
      "model/normalizer/weight_delta": 6.595586776733398,
      "model/normalizer/weight_delta_rel": 0.08494734019041061,
      "model/normalizer/weight_norm": 78.62430572509766,
      "pose_mae_dtheta": 0.18917755782604218,
      "pose_mae_dx": 0.06183478608727455,
      "pose_mae_dy": 0.06275845319032669,
      "pose_rmse_dtheta": 0.3475361168384552,
      "pose_rmse_dx": 0.13646622002124786,
      "pose_rmse_dy": 0.16020719707012177,
      "pose_rmse_mean": 0.21473652124404907,
      "rmse_dtheta": 0.04073642939329147,
      "rmse_dx": 0.01539358776062727,
      "rmse_dy": 0.010114419274032116,
      "rmse_mean": 0.02208147943019867,
      "rotation_flip": 0.011505273170769215,
      "sparse_tokens": 18172.0,
      "step": 8750,
      "turn_loss": 0.2328793704509735,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4065694108901691,
      "grad_norm": 0.6612342000007629,
      "learning_rate": 1.73570043276035e-06,
      "loss": 0.1274,
      "mae_dtheta": 0.01435487437993288,
      "mae_dx": 0.002777810674160719,
      "mae_dy": 0.003760770196095109,
      "pose_mae_dtheta": 0.09999403357505798,
      "pose_mae_dx": 0.03453249856829643,
      "pose_mae_dy": 0.04296329617500305,
      "pose_rmse_dtheta": 0.19510947167873383,
      "pose_rmse_dx": 0.08382554352283478,
      "pose_rmse_dy": 0.10360947996377945,
      "pose_rmse_mean": 0.12751483917236328,
      "rmse_dtheta": 0.025202827528119087,
      "rmse_dx": 0.007697593420743942,
      "rmse_dy": 0.007551172748208046,
      "rmse_mean": 0.013483865186572075,
      "rotation_flip": 0.007868628017604351,
      "sparse_tokens": 32121.0,
      "step": 8751,
      "turn_loss": 0.13729692995548248,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4066158706560119,
      "grad_norm": 0.5996899604797363,
      "learning_rate": 1.734698994122691e-06,
      "loss": 0.0844,
      "mae_dtheta": 0.008677401579916477,
      "mae_dx": 0.0019098533084616065,
      "mae_dy": 0.0013896204764023423,
      "pose_mae_dtheta": 0.06373602896928787,
      "pose_mae_dx": 0.017143767327070236,
      "pose_mae_dy": 0.01931914873421192,
      "pose_rmse_dtheta": 0.20169150829315186,
      "pose_rmse_dx": 0.047230467200279236,
      "pose_rmse_dy": 0.06188922002911568,
      "pose_rmse_mean": 0.10360373556613922,
      "rmse_dtheta": 0.02515619806945324,
      "rmse_dx": 0.00617601815611124,
      "rmse_dy": 0.004246165044605732,
      "rmse_mean": 0.011859460733830929,
      "rotation_flip": 0.005685407668352127,
      "sparse_tokens": 32105.0,
      "step": 8752,
      "turn_loss": 0.06277954578399658,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.4066623304218547,
      "grad_norm": 0.5112537145614624,
      "learning_rate": 1.7336977838292867e-06,
      "loss": 0.0703,
      "mae_dtheta": 0.03369065746665001,
      "mae_dx": 0.006837671156972647,
      "mae_dy": 0.0019852365367114544,
      "pose_mae_dtheta": 0.2999263107776642,
      "pose_mae_dx": 0.05199863389134407,
      "pose_mae_dy": 0.03194943070411682,
      "pose_rmse_dtheta": 0.5936660170555115,
      "pose_rmse_dx": 0.14131611585617065,
      "pose_rmse_dy": 0.08261388540267944,
      "pose_rmse_mean": 0.27253201603889465,
      "rmse_dtheta": 0.05694488435983658,
      "rmse_dx": 0.01635114848613739,
      "rmse_dy": 0.004225290846079588,
      "rmse_mean": 0.02584044262766838,
      "rotation_flip": 0.010273972526192665,
      "sparse_tokens": 5478.0,
      "step": 8753,
      "turn_loss": 0.1472129225730896,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.40670879018769746,
      "grad_norm": 0.4855859875679016,
      "learning_rate": 1.7326968019501472e-06,
      "loss": 0.1109,
      "mae_dtheta": 0.009574267081916332,
      "mae_dx": 0.0020460367668420076,
      "mae_dy": 0.0026393497828394175,
      "pose_mae_dtheta": 0.05750039964914322,
      "pose_mae_dx": 0.02310524508357048,
      "pose_mae_dy": 0.02704479545354843,
      "pose_rmse_dtheta": 0.13313494622707367,
      "pose_rmse_dx": 0.06323215365409851,
      "pose_rmse_dy": 0.0633440762758255,
      "pose_rmse_mean": 0.08657039701938629,
      "rmse_dtheta": 0.01946120895445347,
      "rmse_dx": 0.006572851445525885,
      "rmse_dy": 0.00580207072198391,
      "rmse_mean": 0.010612043552100658,
      "rotation_flip": 0.003237742930650711,
      "sparse_tokens": 32041.0,
      "step": 8754,
      "turn_loss": 0.08120359480381012,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.40675524995354023,
      "grad_norm": 0.7157739400863647,
      "learning_rate": 1.7316960485552758e-06,
      "loss": 0.1555,
      "mae_dtheta": 0.022598251700401306,
      "mae_dx": 0.008360235951840878,
      "mae_dy": 0.004513289779424667,
      "pose_mae_dtheta": 0.18412712216377258,
      "pose_mae_dx": 0.06394010037183762,
      "pose_mae_dy": 0.05437798053026199,
      "pose_rmse_dtheta": 0.31024160981178284,
      "pose_rmse_dx": 0.1423068344593048,
      "pose_rmse_dy": 0.14199289679527283,
      "pose_rmse_mean": 0.1981804370880127,
      "rmse_dtheta": 0.03624697029590607,
      "rmse_dx": 0.01910056360065937,
      "rmse_dy": 0.009303878992795944,
      "rmse_mean": 0.02155047282576561,
      "rotation_flip": 0.013114754110574722,
      "sparse_tokens": 10307.0,
      "step": 8755,
      "turn_loss": 0.1877034455537796,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.406801709719383,
      "grad_norm": 0.611984372138977,
      "learning_rate": 1.7306955237146523e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.022156519815325737,
      "mae_dx": 0.008981119841337204,
      "mae_dy": 0.0021913740783929825,
      "pose_mae_dtheta": 0.15667162835597992,
      "pose_mae_dx": 0.06255003064870834,
      "pose_mae_dy": 0.02774551883339882,
      "pose_rmse_dtheta": 0.32463958859443665,
      "pose_rmse_dx": 0.140550434589386,
      "pose_rmse_dy": 0.08280126750469208,
      "pose_rmse_mean": 0.18266376852989197,
      "rmse_dtheta": 0.038941044360399246,
      "rmse_dx": 0.0194332767277956,
      "rmse_dy": 0.0047910092398524284,
      "rmse_mean": 0.021055109798908234,
      "rotation_flip": 0.009540329687297344,
      "sparse_tokens": 22064.0,
      "step": 8756,
      "turn_loss": 0.1784665584564209,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.4068481694852258,
      "grad_norm": 0.7049193382263184,
      "learning_rate": 1.7296952274982458e-06,
      "loss": 0.1363,
      "mae_dtheta": 0.02333994396030903,
      "mae_dx": 0.009515248239040375,
      "mae_dy": 0.0037108317483216524,
      "pose_mae_dtheta": 0.16914793848991394,
      "pose_mae_dx": 0.06657693535089493,
      "pose_mae_dy": 0.03906535729765892,
      "pose_rmse_dtheta": 0.343749076128006,
      "pose_rmse_dx": 0.1516910344362259,
      "pose_rmse_dy": 0.10446154326200485,
      "pose_rmse_mean": 0.19996723532676697,
      "rmse_dtheta": 0.03983594849705696,
      "rmse_dx": 0.020379945635795593,
      "rmse_dy": 0.009159412235021591,
      "rmse_mean": 0.02312510274350643,
      "rotation_flip": 0.005215123761445284,
      "sparse_tokens": 13181.0,
      "step": 8757,
      "turn_loss": 0.1830764263868332,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40689462925106856,
      "grad_norm": 0.48523658514022827,
      "learning_rate": 1.7286951599760087e-06,
      "loss": 0.1077,
      "mae_dtheta": 0.015482505783438683,
      "mae_dx": 0.004004795104265213,
      "mae_dy": 0.004601301625370979,
      "pose_mae_dtheta": 0.10437828302383423,
      "pose_mae_dx": 0.04564478248357773,
      "pose_mae_dy": 0.04253557324409485,
      "pose_rmse_dtheta": 0.21859130263328552,
      "pose_rmse_dx": 0.12397848814725876,
      "pose_rmse_dy": 0.09340573847293854,
      "pose_rmse_mean": 0.1453251838684082,
      "rmse_dtheta": 0.027748622000217438,
      "rmse_dx": 0.011105915531516075,
      "rmse_dy": 0.009162026457488537,
      "rmse_mean": 0.01600552350282669,
      "rotation_flip": 0.0036581309977918863,
      "sparse_tokens": 32105.0,
      "step": 8758,
      "turn_loss": 0.17805272340774536,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.40694108901691134,
      "grad_norm": 0.9396421313285828,
      "learning_rate": 1.7276953212178732e-06,
      "loss": 0.2979,
      "mae_dtheta": 0.028618505224585533,
      "mae_dx": 0.01153460331261158,
      "mae_dy": 0.005147350952029228,
      "pose_mae_dtheta": 0.24142847955226898,
      "pose_mae_dx": 0.09131231158971786,
      "pose_mae_dy": 0.047526512295007706,
      "pose_rmse_dtheta": 0.45012572407722473,
      "pose_rmse_dx": 0.20819833874702454,
      "pose_rmse_dy": 0.12508328258991241,
      "pose_rmse_mean": 0.2611357867717743,
      "rmse_dtheta": 0.04692087322473526,
      "rmse_dx": 0.024135075509548187,
      "rmse_dy": 0.01315218023955822,
      "rmse_mean": 0.028069376945495605,
      "rotation_flip": 0.02255639061331749,
      "sparse_tokens": 12572.0,
      "step": 8759,
      "turn_loss": 0.3055444657802582,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4069875487827541,
      "grad_norm": 0.4313485026359558,
      "learning_rate": 1.7266957112937622e-06,
      "loss": 0.0969,
      "mae_dtheta": 0.008049258962273598,
      "mae_dx": 0.0012683840468525887,
      "mae_dy": 0.0017062956467270851,
      "pose_mae_dtheta": 0.05567128583788872,
      "pose_mae_dx": 0.0173424631357193,
      "pose_mae_dy": 0.021714139729738235,
      "pose_rmse_dtheta": 0.15951012074947357,
      "pose_rmse_dx": 0.04798304662108421,
      "pose_rmse_dy": 0.058069463819265366,
      "pose_rmse_mean": 0.08852087706327438,
      "rmse_dtheta": 0.02023845724761486,
      "rmse_dx": 0.0037715048529207706,
      "rmse_dy": 0.003944880794733763,
      "rmse_mean": 0.009318280965089798,
      "rotation_flip": 0.0012091898825019598,
      "sparse_tokens": 32137.0,
      "step": 8760,
      "turn_loss": 0.06697551906108856,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4070340085485969,
      "grad_norm": 0.4758422076702118,
      "learning_rate": 1.7256963302735752e-06,
      "loss": 0.126,
      "mae_dtheta": 0.006336358841508627,
      "mae_dx": 0.0013481731293722987,
      "mae_dy": 0.0012168575776740909,
      "pose_mae_dtheta": 0.04425937309861183,
      "pose_mae_dx": 0.012755604460835457,
      "pose_mae_dy": 0.01869826950132847,
      "pose_rmse_dtheta": 0.09475009888410568,
      "pose_rmse_dx": 0.044371433556079865,
      "pose_rmse_dy": 0.04906180128455162,
      "pose_rmse_mean": 0.06272777915000916,
      "rmse_dtheta": 0.014027069322764874,
      "rmse_dx": 0.005579913500696421,
      "rmse_dy": 0.002735402202233672,
      "rmse_mean": 0.007447462063282728,
      "rotation_flip": 0.004564126022160053,
      "sparse_tokens": 32121.0,
      "step": 8761,
      "turn_loss": 0.055207863450050354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.40708046831443967,
      "grad_norm": 0.6517943143844604,
      "learning_rate": 1.7246971782272025e-06,
      "loss": 0.1185,
      "mae_dtheta": 0.006379295140504837,
      "mae_dx": 0.001193769508972764,
      "mae_dy": 0.0015037100529298186,
      "pose_mae_dtheta": 0.04284527897834778,
      "pose_mae_dx": 0.012252232991158962,
      "pose_mae_dy": 0.016607128083705902,
      "pose_rmse_dtheta": 0.10738535970449448,
      "pose_rmse_dx": 0.03350360319018364,
      "pose_rmse_dy": 0.04421330243349075,
      "pose_rmse_mean": 0.06170075386762619,
      "rmse_dtheta": 0.015420478768646717,
      "rmse_dx": 0.004205938428640366,
      "rmse_dy": 0.004742237739264965,
      "rmse_mean": 0.008122885599732399,
      "rotation_flip": 0.0036563072353601456,
      "sparse_tokens": 32121.0,
      "step": 8762,
      "turn_loss": 0.052020151168107986,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14297.0,
      "epoch": 0.4071269280802825,
      "grad_norm": 0.6615914702415466,
      "learning_rate": 1.7236982552245129e-06,
      "loss": 0.1324,
      "mae_dtheta": 0.027369299903512,
      "mae_dx": 0.00914162490516901,
      "mae_dy": 0.0065819560550153255,
      "pose_mae_dtheta": 0.21784090995788574,
      "pose_mae_dx": 0.07522940635681152,
      "pose_mae_dy": 0.06859716773033142,
      "pose_rmse_dtheta": 0.4027178883552551,
      "pose_rmse_dx": 0.1749468892812729,
      "pose_rmse_dy": 0.15990766882896423,
      "pose_rmse_mean": 0.24585747718811035,
      "rmse_dtheta": 0.042682304978370667,
      "rmse_dx": 0.02013474889099598,
      "rmse_dy": 0.014066840521991253,
      "rmse_mean": 0.02562796324491501,
      "rotation_flip": 0.011437908746302128,
      "sparse_tokens": 10922.0,
      "step": 8763,
      "turn_loss": 0.23991990089416504,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.4071733878461253,
      "grad_norm": 0.6386197209358215,
      "learning_rate": 1.7226995613353626e-06,
      "loss": 0.1341,
      "mae_dtheta": 0.022529490292072296,
      "mae_dx": 0.0037596907932311296,
      "mae_dy": 0.007690954953432083,
      "pose_mae_dtheta": 0.13941378891468048,
      "pose_mae_dx": 0.04653797298669815,
      "pose_mae_dy": 0.07691753655672073,
      "pose_rmse_dtheta": 0.2272808849811554,
      "pose_rmse_dx": 0.08510204404592514,
      "pose_rmse_dy": 0.13185220956802368,
      "pose_rmse_mean": 0.14807838201522827,
      "rmse_dtheta": 0.03229348361492157,
      "rmse_dx": 0.00976679939776659,
      "rmse_dy": 0.01198037713766098,
      "rmse_mean": 0.01801355369389057,
      "rotation_flip": 0.022522522136569023,
      "sparse_tokens": 3809.0,
      "step": 8764,
      "turn_loss": 0.235772505402565,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.40721984761196806,
      "grad_norm": 0.4642428755760193,
      "learning_rate": 1.7217010966295927e-06,
      "loss": 0.1029,
      "mae_dtheta": 0.014689709059894085,
      "mae_dx": 0.0037786115426570177,
      "mae_dy": 0.0037025432102382183,
      "pose_mae_dtheta": 0.11072535812854767,
      "pose_mae_dx": 0.03339315950870514,
      "pose_mae_dy": 0.03026426210999489,
      "pose_rmse_dtheta": 0.28160008788108826,
      "pose_rmse_dx": 0.0830846056342125,
      "pose_rmse_dy": 0.07487975805997849,
      "pose_rmse_mean": 0.14652149379253387,
      "rmse_dtheta": 0.032539259642362595,
      "rmse_dx": 0.010935046710073948,
      "rmse_dy": 0.009242605417966843,
      "rmse_mean": 0.017572304233908653,
      "rotation_flip": 0.010731052607297897,
      "sparse_tokens": 32169.0,
      "step": 8765,
      "turn_loss": 0.14598795771598816,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.40726630737781083,
      "grad_norm": 0.4399298429489136,
      "learning_rate": 1.7207028611770233e-06,
      "loss": 0.0777,
      "mae_dtheta": 0.007232208736240864,
      "mae_dx": 0.001077580265700817,
      "mae_dy": 0.0003823160659521818,
      "pose_mae_dtheta": 0.050536371767520905,
      "pose_mae_dx": 0.008304801769554615,
      "pose_mae_dy": 0.006007316987961531,
      "pose_rmse_dtheta": 0.23338767886161804,
      "pose_rmse_dx": 0.019832385703921318,
      "pose_rmse_dy": 0.015993565320968628,
      "pose_rmse_mean": 0.08973787724971771,
      "rmse_dtheta": 0.027504004538059235,
      "rmse_dx": 0.0033284465316683054,
      "rmse_dy": 0.0008246702491305768,
      "rmse_mean": 0.01055237464606762,
      "rotation_flip": 0.0020607933402061462,
      "sparse_tokens": 32201.0,
      "step": 8766,
      "turn_loss": 0.037973519414663315,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 38938.0,
      "epoch": 0.4073127671436536,
      "grad_norm": 0.5480111241340637,
      "learning_rate": 1.7197048550474643e-06,
      "loss": 0.1538,
      "mae_dtheta": 0.03345770761370659,
      "mae_dx": 0.011104917153716087,
      "mae_dy": 0.00381985935382545,
      "pose_mae_dtheta": 0.2417812943458557,
      "pose_mae_dx": 0.08926352858543396,
      "pose_mae_dy": 0.04397765174508095,
      "pose_rmse_dtheta": 0.4416869878768921,
      "pose_rmse_dx": 0.202840194106102,
      "pose_rmse_dy": 0.11860965192317963,
      "pose_rmse_mean": 0.2543789744377136,
      "rmse_dtheta": 0.053593773394823074,
      "rmse_dx": 0.02293391525745392,
      "rmse_dy": 0.008823416195809841,
      "rmse_mean": 0.028450367972254753,
      "rotation_flip": 0.020821284502744675,
      "sparse_tokens": 29938.0,
      "step": 8767,
      "turn_loss": 0.21238388121128082,
      "turns": 120.0,
      "turns_per_sample": 120.0
    },
    {
      "dense_tokens": 12959.0,
      "epoch": 0.4073592269094964,
      "grad_norm": 0.9124435186386108,
      "learning_rate": 1.718707078310704e-06,
      "loss": 0.2512,
      "mae_dtheta": 0.03236813470721245,
      "mae_dx": 0.01617388427257538,
      "mae_dy": 0.0040731169283390045,
      "pose_mae_dtheta": 0.2543054223060608,
      "pose_mae_dx": 0.13476790487766266,
      "pose_mae_dy": 0.05821335315704346,
      "pose_rmse_dtheta": 0.44111472368240356,
      "pose_rmse_dx": 0.2798236906528473,
      "pose_rmse_dy": 0.13246680796146393,
      "pose_rmse_mean": 0.284468412399292,
      "rmse_dtheta": 0.04939405620098114,
      "rmse_dx": 0.030278099700808525,
      "rmse_dy": 0.0075895111076533794,
      "rmse_mean": 0.02908722311258316,
      "rotation_flip": 0.017761988565325737,
      "sparse_tokens": 10333.0,
      "step": 8768,
      "turn_loss": 0.24721641838550568,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.40740568667533916,
      "grad_norm": 0.9294387102127075,
      "learning_rate": 1.7177095310365205e-06,
      "loss": 0.2734,
      "mae_dtheta": 0.039041779935359955,
      "mae_dx": 0.010109770111739635,
      "mae_dy": 0.006180026568472385,
      "pose_mae_dtheta": 0.29927581548690796,
      "pose_mae_dx": 0.08862118422985077,
      "pose_mae_dy": 0.07729630172252655,
      "pose_rmse_dtheta": 0.5471697449684143,
      "pose_rmse_dx": 0.18429119884967804,
      "pose_rmse_dy": 0.1958385556936264,
      "pose_rmse_mean": 0.30909985303878784,
      "rmse_dtheta": 0.058889906853437424,
      "rmse_dx": 0.021461891010403633,
      "rmse_dy": 0.014650403521955013,
      "rmse_mean": 0.031667403876781464,
      "rotation_flip": 0.018803419545292854,
      "sparse_tokens": 18973.0,
      "step": 8769,
      "turn_loss": 0.3366551399230957,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.40745214644118194,
      "grad_norm": 0.42694979906082153,
      "learning_rate": 1.7167122132946696e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.009542866609990597,
      "mae_dx": 0.0018917733104899526,
      "mae_dy": 0.0024302885867655277,
      "pose_mae_dtheta": 0.0678568109869957,
      "pose_mae_dx": 0.024545617401599884,
      "pose_mae_dy": 0.02618980035185814,
      "pose_rmse_dtheta": 0.18704953789710999,
      "pose_rmse_dx": 0.06564683467149734,
      "pose_rmse_dy": 0.06205875426530838,
      "pose_rmse_mean": 0.10491837561130524,
      "rmse_dtheta": 0.022670097649097443,
      "rmse_dx": 0.005586293991655111,
      "rmse_dy": 0.005621005315333605,
      "rmse_mean": 0.011292466893792152,
      "rotation_flip": 0.0038910505827516317,
      "sparse_tokens": 32057.0,
      "step": 8770,
      "turn_loss": 0.07563167065382004,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.4074986062070247,
      "grad_norm": 0.32967323064804077,
      "learning_rate": 1.7157151251548953e-06,
      "loss": 0.0834,
      "mae_dtheta": 0.027857551351189613,
      "mae_dx": 0.0065341670997440815,
      "mae_dy": 0.005137167870998383,
      "pose_mae_dtheta": 0.1975473016500473,
      "pose_mae_dx": 0.05119539797306061,
      "pose_mae_dy": 0.05970776826143265,
      "pose_rmse_dtheta": 0.38126423954963684,
      "pose_rmse_dx": 0.11220201849937439,
      "pose_rmse_dy": 0.17148050665855408,
      "pose_rmse_mean": 0.2216489315032959,
      "rmse_dtheta": 0.043771713972091675,
      "rmse_dx": 0.015992887318134308,
      "rmse_dy": 0.010374855250120163,
      "rmse_mean": 0.023379817605018616,
      "rotation_flip": 0.02017543837428093,
      "sparse_tokens": 18474.0,
      "step": 8771,
      "turn_loss": 0.23721450567245483,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 14297.0,
      "epoch": 0.4075450659728675,
      "grad_norm": 0.602067232131958,
      "learning_rate": 1.7147182666869273e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.03392622992396355,
      "mae_dx": 0.010812386870384216,
      "mae_dy": 0.007386915385723114,
      "pose_mae_dtheta": 0.2618993818759918,
      "pose_mae_dx": 0.09084001928567886,
      "pose_mae_dy": 0.10914774239063263,
      "pose_rmse_dtheta": 0.443872332572937,
      "pose_rmse_dx": 0.18441255390644073,
      "pose_rmse_dy": 0.238475039601326,
      "pose_rmse_mean": 0.28891998529434204,
      "rmse_dtheta": 0.05203935503959656,
      "rmse_dx": 0.021986568346619606,
      "rmse_dy": 0.014661130495369434,
      "rmse_mean": 0.02956235222518444,
      "rotation_flip": 0.015337423421442509,
      "sparse_tokens": 12331.0,
      "step": 8772,
      "turn_loss": 0.27630743384361267,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.40759152573871027,
      "grad_norm": 0.6300914883613586,
      "learning_rate": 1.7137216379604727e-06,
      "loss": 0.1818,
      "mae_dtheta": 0.02325914241373539,
      "mae_dx": 0.009950465522706509,
      "mae_dy": 0.0065586259588599205,
      "pose_mae_dtheta": 0.17978282272815704,
      "pose_mae_dx": 0.09679313749074936,
      "pose_mae_dy": 0.10377458482980728,
      "pose_rmse_dtheta": 0.3071713149547577,
      "pose_rmse_dx": 0.22029608488082886,
      "pose_rmse_dy": 0.21164262294769287,
      "pose_rmse_mean": 0.24637000262737274,
      "rmse_dtheta": 0.03806990757584572,
      "rmse_dx": 0.02307562343776226,
      "rmse_dy": 0.012217883951961994,
      "rmse_mean": 0.024454472586512566,
      "rotation_flip": 0.016574585810303688,
      "sparse_tokens": 12597.0,
      "step": 8773,
      "turn_loss": 0.18040330708026886,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40763798550455305,
      "grad_norm": 0.3675551116466522,
      "learning_rate": 1.7127252390452293e-06,
      "loss": 0.0955,
      "mae_dtheta": 0.006813885178416967,
      "mae_dx": 0.0012340546818450093,
      "mae_dy": 0.0020101675763726234,
      "pose_mae_dtheta": 0.040428195148706436,
      "pose_mae_dx": 0.01863350160419941,
      "pose_mae_dy": 0.019825011491775513,
      "pose_rmse_dtheta": 0.08482540398836136,
      "pose_rmse_dx": 0.056272298097610474,
      "pose_rmse_dy": 0.04957256838679314,
      "pose_rmse_mean": 0.06355676054954529,
      "rmse_dtheta": 0.014563506469130516,
      "rmse_dx": 0.003340293886139989,
      "rmse_dy": 0.004855783190578222,
      "rmse_mean": 0.007586528547108173,
      "rotation_flip": 0.0030710173305124044,
      "sparse_tokens": 32105.0,
      "step": 8774,
      "turn_loss": 0.06769375503063202,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4076844452703958,
      "grad_norm": 0.4668184518814087,
      "learning_rate": 1.7117290700108724e-06,
      "loss": 0.0962,
      "mae_dtheta": 0.008826194331049919,
      "mae_dx": 0.001788423745892942,
      "mae_dy": 0.0020984180737286806,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.46681833267211914,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.046142578125,
      "model/head/act_norm_mean": 107.51967921401516,
      "model/head/act_norm_min": 59.7728271484375,
      "model/head/act_over_embed": 73.8885301709675,
      "model/head/grad_frac": 0.09847889840602875,
      "model/head/grad_norm": 0.04597175493836403,
      "model/head/grad_zero_frac": 0.0001843349018599838,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7059708412247475,
      "model/head/update_ratio": 0.0007829228416085243,
      "model/head/weight_delta": 9.826091766357422,
      "model/head/weight_delta_rel": 0.1723787486553192,
      "model/head/weight_norm": 58.718116760253906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4224846661090851,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42242322160524104,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4223579466342926,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29029319267563103,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10934490710496902,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05104420706629753,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.547540639013453,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016482823994010687,
      "model/modality_embedder.encoders.pose/weight_delta": 3.125988006591797,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10213577002286911,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968120574951172,
      "model/modality_embedder/grad_frac": 0.10934490710496902,
      "model/modality_embedder/grad_norm": 0.05104420706629753,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.547540639013453,
      "model/modality_embedder/update_ratio": 0.0016482823994010687,
      "model/modality_embedder/weight_delta": 3.125988006591797,
      "model/modality_embedder/weight_delta_rel": 0.10213577002286911,
      "model/modality_embedder/weight_norm": 30.968120574951172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 93.52716827392578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.476646424563093,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.994856834411621,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.13337121478646,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06389182806015015,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.029825875535607338,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001067386125214398,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6614251136779785,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09698393940925598,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.94291114807129,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 95.05831909179688,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.495503146544813,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.25158977508545,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.833539092819215,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06560134142637253,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030623909085989,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010296686086803675,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3739490509033203,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11687622964382172,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.741518020629883,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 96.88409423828125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.38377575356742,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.360170364379883,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.131177706651822,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06510047614574432,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030390096828341484,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009895683033391833,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6504695415496826,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12257593125104904,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.710458755493164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 97.35530853271484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.153536856661855,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.559593200683594,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.347374105462812,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06960562616586685,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03249318152666092,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010856065200641751,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1322407722473145,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10704512894153595,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9309024810791,
      "model/normalizer/grad_frac": 0.275068461894989,
      "model/normalizer/grad_norm": 0.12840700149536133,
      "model/normalizer/grad_zero_frac": 0.00020089553436264396,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00163316132966429,
      "model/normalizer/weight_delta": 6.600214004516602,
      "model/normalizer/weight_delta_rel": 0.08500693738460541,
      "model/normalizer/weight_norm": 78.62480926513672,
      "pose_mae_dtheta": 0.05891391262412071,
      "pose_mae_dx": 0.02185775712132454,
      "pose_mae_dy": 0.023321757093071938,
      "pose_rmse_dtheta": 0.1721920222043991,
      "pose_rmse_dx": 0.056254319846630096,
      "pose_rmse_dy": 0.057189926505088806,
      "pose_rmse_mean": 0.09521208703517914,
      "rmse_dtheta": 0.0221132580190897,
      "rmse_dx": 0.005365961231291294,
      "rmse_dy": 0.005478302948176861,
      "rmse_mean": 0.01098584197461605,
      "rotation_flip": 0.00364815560169518,
      "sparse_tokens": 32105.0,
      "step": 8775,
      "turn_loss": 0.07352441549301147,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.4077309050362386,
      "grad_norm": 0.35751208662986755,
      "learning_rate": 1.7107331309270686e-06,
      "loss": 0.0793,
      "mae_dtheta": 0.03115375153720379,
      "mae_dx": 0.010208490304648876,
      "mae_dy": 0.003826524131000042,
      "pose_mae_dtheta": 0.24303941428661346,
      "pose_mae_dx": 0.07987634837627411,
      "pose_mae_dy": 0.04893491417169571,
      "pose_rmse_dtheta": 0.4408263862133026,
      "pose_rmse_dx": 0.18267109990119934,
      "pose_rmse_dy": 0.11534149944782257,
      "pose_rmse_mean": 0.24627965688705444,
      "rmse_dtheta": 0.04928811267018318,
      "rmse_dx": 0.021849483251571655,
      "rmse_dy": 0.007276502437889576,
      "rmse_mean": 0.026138033717870712,
      "rotation_flip": 0.010027347132563591,
      "sparse_tokens": 18934.0,
      "step": 8776,
      "turn_loss": 0.22648468613624573,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4077773648020814,
      "grad_norm": 0.3743162751197815,
      "learning_rate": 1.7097374218634605e-06,
      "loss": 0.12,
      "mae_dtheta": 0.009141634218394756,
      "mae_dx": 0.0018652613507583737,
      "mae_dy": 0.0026228176429867744,
      "pose_mae_dtheta": 0.05876050144433975,
      "pose_mae_dx": 0.022272439673542976,
      "pose_mae_dy": 0.02763727493584156,
      "pose_rmse_dtheta": 0.1051800325512886,
      "pose_rmse_dx": 0.05585745349526405,
      "pose_rmse_dy": 0.05936909094452858,
      "pose_rmse_mean": 0.07346886396408081,
      "rmse_dtheta": 0.017622273415327072,
      "rmse_dx": 0.004901941400021315,
      "rmse_dy": 0.00601529935374856,
      "rmse_mean": 0.009513171389698982,
      "rotation_flip": 0.007771105505526066,
      "sparse_tokens": 32121.0,
      "step": 8777,
      "turn_loss": 0.0848873034119606,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40782382456792415,
      "grad_norm": 0.36887747049331665,
      "learning_rate": 1.7087419428896806e-06,
      "loss": 0.0967,
      "mae_dtheta": 0.010267948731780052,
      "mae_dx": 0.002578878542408347,
      "mae_dy": 0.003295641392469406,
      "pose_mae_dtheta": 0.07420103251934052,
      "pose_mae_dx": 0.02789340913295746,
      "pose_mae_dy": 0.02978220023214817,
      "pose_rmse_dtheta": 0.20426087081432343,
      "pose_rmse_dx": 0.07575120776891708,
      "pose_rmse_dy": 0.07416702806949615,
      "pose_rmse_mean": 0.11805969476699829,
      "rmse_dtheta": 0.02511644922196865,
      "rmse_dx": 0.0068160537630319595,
      "rmse_dy": 0.008173724636435509,
      "rmse_mean": 0.013368743471801281,
      "rotation_flip": 0.008576328866183758,
      "sparse_tokens": 32105.0,
      "step": 8778,
      "turn_loss": 0.09746302664279938,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40787028433376693,
      "grad_norm": 0.43072712421417236,
      "learning_rate": 1.7077466940753446e-06,
      "loss": 0.1014,
      "mae_dtheta": 0.00903466995805502,
      "mae_dx": 0.0019983418751507998,
      "mae_dy": 0.002538397442549467,
      "pose_mae_dtheta": 0.056497130542993546,
      "pose_mae_dx": 0.021879294887185097,
      "pose_mae_dy": 0.02315821312367916,
      "pose_rmse_dtheta": 0.13964396715164185,
      "pose_rmse_dx": 0.05691993236541748,
      "pose_rmse_dy": 0.05433041602373123,
      "pose_rmse_mean": 0.08363144099712372,
      "rmse_dtheta": 0.020042667165398598,
      "rmse_dx": 0.005347078666090965,
      "rmse_dy": 0.0055960095487535,
      "rmse_mean": 0.010328585281968117,
      "rotation_flip": 0.006235385779291391,
      "sparse_tokens": 32105.0,
      "step": 8779,
      "turn_loss": 0.07496053725481033,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.40791674409960976,
      "grad_norm": 0.619515597820282,
      "learning_rate": 1.7067516754900476e-06,
      "loss": 0.1604,
      "mae_dtheta": 0.039755091071128845,
      "mae_dx": 0.015677008777856827,
      "mae_dy": 0.006486327853053808,
      "pose_mae_dtheta": 0.325246125459671,
      "pose_mae_dx": 0.13428369164466858,
      "pose_mae_dy": 0.06372049450874329,
      "pose_rmse_dtheta": 0.536752462387085,
      "pose_rmse_dx": 0.2613380551338196,
      "pose_rmse_dy": 0.13656698167324066,
      "pose_rmse_mean": 0.3115525245666504,
      "rmse_dtheta": 0.05714251101016998,
      "rmse_dx": 0.02723613567650318,
      "rmse_dy": 0.01298095379024744,
      "rmse_mean": 0.032453201711177826,
      "rotation_flip": 0.020779220387339592,
      "sparse_tokens": 25761.0,
      "step": 8780,
      "turn_loss": 0.32579362392425537,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.40796320386545254,
      "grad_norm": 0.47597792744636536,
      "learning_rate": 1.7057568872033758e-06,
      "loss": 0.1246,
      "mae_dtheta": 0.036720797419548035,
      "mae_dx": 0.014397434890270233,
      "mae_dy": 0.007846185937523842,
      "pose_mae_dtheta": 0.26652342081069946,
      "pose_mae_dx": 0.10848065465688705,
      "pose_mae_dy": 0.10316310077905655,
      "pose_rmse_dtheta": 0.500521719455719,
      "pose_rmse_dx": 0.23145878314971924,
      "pose_rmse_dy": 0.2110150158405304,
      "pose_rmse_mean": 0.31433185935020447,
      "rmse_dtheta": 0.05399417504668236,
      "rmse_dx": 0.02730509079992771,
      "rmse_dy": 0.014092624187469482,
      "rmse_mean": 0.031797297298908234,
      "rotation_flip": 0.008729388937354088,
      "sparse_tokens": 17614.0,
      "step": 8781,
      "turn_loss": 0.3610689342021942,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4080096636312953,
      "grad_norm": 0.3885642886161804,
      "learning_rate": 1.7047623292848909e-06,
      "loss": 0.0788,
      "mae_dtheta": 0.01052561029791832,
      "mae_dx": 0.0015361043624579906,
      "mae_dy": 0.0020669721998274326,
      "pose_mae_dtheta": 0.07451785355806351,
      "pose_mae_dx": 0.019934281706809998,
      "pose_mae_dy": 0.02831754833459854,
      "pose_rmse_dtheta": 0.18711213767528534,
      "pose_rmse_dx": 0.05256226658821106,
      "pose_rmse_dy": 0.07619531452655792,
      "pose_rmse_mean": 0.10528990626335144,
      "rmse_dtheta": 0.024086812511086464,
      "rmse_dx": 0.004825500771403313,
      "rmse_dy": 0.005146688781678677,
      "rmse_mean": 0.01135300099849701,
      "rotation_flip": 0.0030592733528465033,
      "sparse_tokens": 32121.0,
      "step": 8782,
      "turn_loss": 0.08069772273302078,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4080561233971381,
      "grad_norm": 0.4965639114379883,
      "learning_rate": 1.703768001804147e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.01327128428965807,
      "mae_dx": 0.0024627309758216143,
      "mae_dy": 0.0029556171502918005,
      "pose_mae_dtheta": 0.09421251714229584,
      "pose_mae_dx": 0.02778409793972969,
      "pose_mae_dy": 0.031418994069099426,
      "pose_rmse_dtheta": 0.2360193282365799,
      "pose_rmse_dx": 0.07685405015945435,
      "pose_rmse_dy": 0.07619768381118774,
      "pose_rmse_mean": 0.12969034910202026,
      "rmse_dtheta": 0.027875930070877075,
      "rmse_dx": 0.007522279396653175,
      "rmse_dy": 0.006938433740288019,
      "rmse_mean": 0.014112214557826519,
      "rotation_flip": 0.012098298408091068,
      "sparse_tokens": 32137.0,
      "step": 8783,
      "turn_loss": 0.1210034191608429,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.40810258316298087,
      "grad_norm": 0.37955954670906067,
      "learning_rate": 1.7027739048306736e-06,
      "loss": 0.0974,
      "mae_dtheta": 0.009133690968155861,
      "mae_dx": 0.001253007329069078,
      "mae_dy": 0.0020315872970968485,
      "pose_mae_dtheta": 0.056466467678546906,
      "pose_mae_dx": 0.015734724700450897,
      "pose_mae_dy": 0.023001113906502724,
      "pose_rmse_dtheta": 0.14469005167484283,
      "pose_rmse_dx": 0.03956861421465874,
      "pose_rmse_dy": 0.05020545423030853,
      "pose_rmse_mean": 0.07815471291542053,
      "rmse_dtheta": 0.020424047484993935,
      "rmse_dx": 0.003910505212843418,
      "rmse_dy": 0.004271253943443298,
      "rmse_mean": 0.009535269811749458,
      "rotation_flip": 0.005321170669049025,
      "sparse_tokens": 32073.0,
      "step": 8784,
      "turn_loss": 0.07289128005504608,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.40814904292882365,
      "grad_norm": 0.6558775305747986,
      "learning_rate": 1.7017800384339928e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.008527066558599472,
      "mae_dx": 0.0014620727160945535,
      "mae_dy": 0.00022142179659567773,
      "pose_mae_dtheta": 0.06036294624209404,
      "pose_mae_dx": 0.011433799751102924,
      "pose_mae_dy": 0.003082914976403117,
      "pose_rmse_dtheta": 0.2524130344390869,
      "pose_rmse_dx": 0.0236129779368639,
      "pose_rmse_dy": 0.007338819094002247,
      "pose_rmse_mean": 0.09445494413375854,
      "rmse_dtheta": 0.030892418697476387,
      "rmse_dx": 0.0036951357033103704,
      "rmse_dy": 0.0005122586735524237,
      "rmse_mean": 0.011699937283992767,
      "rotation_flip": 0.0015487867640331388,
      "sparse_tokens": 32265.0,
      "step": 8785,
      "turn_loss": 0.05197187513113022,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.4081955026946664,
      "grad_norm": 0.43941763043403625,
      "learning_rate": 1.7007864026836046e-06,
      "loss": 0.1084,
      "mae_dtheta": 0.007292693946510553,
      "mae_dx": 0.0013931372668594122,
      "mae_dy": 0.0002128101623384282,
      "pose_mae_dtheta": 0.05025152862071991,
      "pose_mae_dx": 0.011361071839928627,
      "pose_mae_dy": 0.0029935319907963276,
      "pose_rmse_dtheta": 0.23456816375255585,
      "pose_rmse_dx": 0.026568252593278885,
      "pose_rmse_dy": 0.011639616452157497,
      "pose_rmse_mean": 0.09092535078525543,
      "rmse_dtheta": 0.028572019189596176,
      "rmse_dx": 0.0037507335655391216,
      "rmse_dy": 0.0006983420462347567,
      "rmse_mean": 0.011007032357156277,
      "rotation_flip": 0.0,
      "sparse_tokens": 32233.0,
      "step": 8786,
      "turn_loss": 0.040391646325588226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4082419624605092,
      "grad_norm": 0.3654433786869049,
      "learning_rate": 1.699792997648992e-06,
      "loss": 0.0863,
      "mae_dtheta": 0.007261582650244236,
      "mae_dx": 0.0010928340489044785,
      "mae_dy": 0.0015418920665979385,
      "pose_mae_dtheta": 0.04602551460266113,
      "pose_mae_dx": 0.013726957142353058,
      "pose_mae_dy": 0.019848627969622612,
      "pose_rmse_dtheta": 0.11342877149581909,
      "pose_rmse_dx": 0.034462761133909225,
      "pose_rmse_dy": 0.054624274373054504,
      "pose_rmse_mean": 0.06750527024269104,
      "rmse_dtheta": 0.018339255824685097,
      "rmse_dx": 0.00311527238227427,
      "rmse_dy": 0.004607639275491238,
      "rmse_mean": 0.008687390014529228,
      "rotation_flip": 0.005329457577317953,
      "sparse_tokens": 32089.0,
      "step": 8787,
      "turn_loss": 0.06200379878282547,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.408288422226352,
      "grad_norm": 0.6617145538330078,
      "learning_rate": 1.6987998233996279e-06,
      "loss": 0.106,
      "mae_dtheta": 0.035142820328474045,
      "mae_dx": 0.01784699410200119,
      "mae_dy": 0.004290279932320118,
      "pose_mae_dtheta": 0.3004515469074249,
      "pose_mae_dx": 0.15158960223197937,
      "pose_mae_dy": 0.0659041702747345,
      "pose_rmse_dtheta": 0.5172901749610901,
      "pose_rmse_dx": 0.3025464117527008,
      "pose_rmse_dy": 0.13958275318145752,
      "pose_rmse_mean": 0.31980645656585693,
      "rmse_dtheta": 0.05194374918937683,
      "rmse_dx": 0.031265027821063995,
      "rmse_dy": 0.008232774212956429,
      "rmse_mean": 0.03048051707446575,
      "rotation_flip": 0.008833922445774078,
      "sparse_tokens": 10493.0,
      "step": 8788,
      "turn_loss": 0.2816254198551178,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.40833488199219475,
      "grad_norm": 0.4786624610424042,
      "learning_rate": 1.6978068800049624e-06,
      "loss": 0.1256,
      "mae_dtheta": 0.04362982511520386,
      "mae_dx": 0.014467509463429451,
      "mae_dy": 0.004733863286674023,
      "pose_mae_dtheta": 0.36244121193885803,
      "pose_mae_dx": 0.11296818405389786,
      "pose_mae_dy": 0.05742201581597328,
      "pose_rmse_dtheta": 0.6444968581199646,
      "pose_rmse_dx": 0.2476872056722641,
      "pose_rmse_dy": 0.1440850794315338,
      "pose_rmse_mean": 0.3454230725765228,
      "rmse_dtheta": 0.06415106356143951,
      "rmse_dx": 0.027072662487626076,
      "rmse_dy": 0.010018454864621162,
      "rmse_mean": 0.033747393637895584,
      "rotation_flip": 0.014414414763450623,
      "sparse_tokens": 9607.0,
      "step": 8789,
      "turn_loss": 0.3550002872943878,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.40838134175803753,
      "grad_norm": 0.44629865884780884,
      "learning_rate": 1.6968141675344346e-06,
      "loss": 0.092,
      "mae_dtheta": 0.008355704136192799,
      "mae_dx": 0.0012412483338266611,
      "mae_dy": 0.0020430278964340687,
      "pose_mae_dtheta": 0.04824936017394066,
      "pose_mae_dx": 0.017103897407650948,
      "pose_mae_dy": 0.02197590470314026,
      "pose_rmse_dtheta": 0.11110097169876099,
      "pose_rmse_dx": 0.04054640606045723,
      "pose_rmse_dy": 0.055334366858005524,
      "pose_rmse_mean": 0.06899391859769821,
      "rmse_dtheta": 0.0191193800419569,
      "rmse_dx": 0.0032810212578624487,
      "rmse_dy": 0.00494682602584362,
      "rmse_mean": 0.009115742519497871,
      "rotation_flip": 0.0037009622901678085,
      "sparse_tokens": 32137.0,
      "step": 8790,
      "turn_loss": 0.07607342302799225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4084278015238803,
      "grad_norm": 0.6322678923606873,
      "learning_rate": 1.6958216860574661e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.007759703788906336,
      "mae_dx": 0.0019172858446836472,
      "mae_dy": 0.0010917986510321498,
      "pose_mae_dtheta": 0.048203665763139725,
      "pose_mae_dx": 0.015879400074481964,
      "pose_mae_dy": 0.013302826322615147,
      "pose_rmse_dtheta": 0.1569751501083374,
      "pose_rmse_dx": 0.04371335357427597,
      "pose_rmse_dy": 0.03175706788897514,
      "pose_rmse_mean": 0.07748186588287354,
      "rmse_dtheta": 0.020065078511834145,
      "rmse_dx": 0.006205842364579439,
      "rmse_dy": 0.0022011161781847477,
      "rmse_mean": 0.009490679018199444,
      "rotation_flip": 0.006982543505728245,
      "sparse_tokens": 32153.0,
      "step": 8791,
      "turn_loss": 0.05349453166127205,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4084742612897231,
      "grad_norm": 0.3539380431175232,
      "learning_rate": 1.6948294356434592e-06,
      "loss": 0.1088,
      "mae_dtheta": 0.010419359430670738,
      "mae_dx": 0.00153666315600276,
      "mae_dy": 0.002276158658787608,
      "pose_mae_dtheta": 0.07047133892774582,
      "pose_mae_dx": 0.015817662701010704,
      "pose_mae_dy": 0.02273240126669407,
      "pose_rmse_dtheta": 0.2039812207221985,
      "pose_rmse_dx": 0.03443590924143791,
      "pose_rmse_dy": 0.0516962967813015,
      "pose_rmse_mean": 0.09670447558164597,
      "rmse_dtheta": 0.02395603246986866,
      "rmse_dx": 0.004147164989262819,
      "rmse_dy": 0.005531484726816416,
      "rmse_mean": 0.011211561039090157,
      "rotation_flip": 0.001849112450145185,
      "sparse_tokens": 32153.0,
      "step": 8792,
      "turn_loss": 0.07565996050834656,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.40852072105556586,
      "grad_norm": 0.43570664525032043,
      "learning_rate": 1.6938374163618054e-06,
      "loss": 0.1268,
      "mae_dtheta": 0.03153715655207634,
      "mae_dx": 0.011215458624064922,
      "mae_dy": 0.004527004901319742,
      "pose_mae_dtheta": 0.26891225576400757,
      "pose_mae_dx": 0.08664467930793762,
      "pose_mae_dy": 0.0361587218940258,
      "pose_rmse_dtheta": 0.41551515460014343,
      "pose_rmse_dx": 0.1758078783750534,
      "pose_rmse_dy": 0.08397769927978516,
      "pose_rmse_mean": 0.22510024905204773,
      "rmse_dtheta": 0.04621854051947594,
      "rmse_dx": 0.0208713561296463,
      "rmse_dy": 0.009899540804326534,
      "rmse_mean": 0.02566314861178398,
      "rotation_flip": 0.007594936527311802,
      "sparse_tokens": 6706.0,
      "step": 8793,
      "turn_loss": 0.27757757902145386,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.40856718082140864,
      "grad_norm": 0.5288401246070862,
      "learning_rate": 1.692845628281874e-06,
      "loss": 0.1075,
      "mae_dtheta": 0.008389982394874096,
      "mae_dx": 0.0016763125313445926,
      "mae_dy": 0.001448506023734808,
      "pose_mae_dtheta": 0.061419527977705,
      "pose_mae_dx": 0.01982995681464672,
      "pose_mae_dy": 0.023619266226887703,
      "pose_rmse_dtheta": 0.15582069754600525,
      "pose_rmse_dx": 0.06704625487327576,
      "pose_rmse_dy": 0.0678752139210701,
      "pose_rmse_mean": 0.09691405296325684,
      "rmse_dtheta": 0.020198026672005653,
      "rmse_dx": 0.00621851347386837,
      "rmse_dy": 0.0035041137598454952,
      "rmse_mean": 0.009973552078008652,
      "rotation_flip": 0.0016816143179312348,
      "sparse_tokens": 32073.0,
      "step": 8794,
      "turn_loss": 0.06495589762926102,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4086136405872514,
      "grad_norm": 0.5413148403167725,
      "learning_rate": 1.6918540714730247e-06,
      "loss": 0.1004,
      "mae_dtheta": 0.012533461675047874,
      "mae_dx": 0.0014110477641224861,
      "mae_dy": 0.002923274878412485,
      "pose_mae_dtheta": 0.07508029043674469,
      "pose_mae_dx": 0.022402077913284302,
      "pose_mae_dy": 0.03256452456116676,
      "pose_rmse_dtheta": 0.16678614914417267,
      "pose_rmse_dx": 0.05852337181568146,
      "pose_rmse_dy": 0.07608795911073685,
      "pose_rmse_mean": 0.10046582669019699,
      "rmse_dtheta": 0.025133684277534485,
      "rmse_dx": 0.0038143936544656754,
      "rmse_dy": 0.0069056060165166855,
      "rmse_mean": 0.011951228603720665,
      "rotation_flip": 0.004301075357943773,
      "sparse_tokens": 32105.0,
      "step": 8795,
      "turn_loss": 0.0993482768535614,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.40866010035309425,
      "grad_norm": 0.47251442074775696,
      "learning_rate": 1.690862746004594e-06,
      "loss": 0.1171,
      "mae_dtheta": 0.031964629888534546,
      "mae_dx": 0.011045851744711399,
      "mae_dy": 0.005068583879619837,
      "pose_mae_dtheta": 0.27032211422920227,
      "pose_mae_dx": 0.1101059690117836,
      "pose_mae_dy": 0.06655170023441315,
      "pose_rmse_dtheta": 0.45132726430892944,
      "pose_rmse_dx": 0.20422610640525818,
      "pose_rmse_dy": 0.17002853751182556,
      "pose_rmse_mean": 0.275193989276886,
      "rmse_dtheta": 0.04932571202516556,
      "rmse_dx": 0.02084278129041195,
      "rmse_dy": 0.012290364131331444,
      "rmse_mean": 0.02748628705739975,
      "rotation_flip": 0.017897091805934906,
      "sparse_tokens": 7432.0,
      "step": 8796,
      "turn_loss": 0.25775572657585144,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.408706560118937,
      "grad_norm": 0.3693414628505707,
      "learning_rate": 1.6898716519459074e-06,
      "loss": 0.052,
      "mae_dtheta": 0.03729182481765747,
      "mae_dx": 0.005936943460255861,
      "mae_dy": 0.002023691777139902,
      "pose_mae_dtheta": 0.3151788115501404,
      "pose_mae_dx": 0.032753586769104004,
      "pose_mae_dy": 0.025015203282237053,
      "pose_rmse_dtheta": 0.49107789993286133,
      "pose_rmse_dx": 0.10200583189725876,
      "pose_rmse_dy": 0.06939522922039032,
      "pose_rmse_mean": 0.22082632780075073,
      "rmse_dtheta": 0.05849258229136467,
      "rmse_dx": 0.01524422224611044,
      "rmse_dy": 0.005654679611325264,
      "rmse_mean": 0.02646382711827755,
      "rotation_flip": 0.02358490601181984,
      "sparse_tokens": 3457.0,
      "step": 8797,
      "turn_loss": 0.2987344563007355,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4087530198847798,
      "grad_norm": 0.4001670479774475,
      "learning_rate": 1.6888807893662752e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.01027480699121952,
      "mae_dx": 0.0015640952624380589,
      "mae_dy": 0.0022458576131612062,
      "pose_mae_dtheta": 0.0759071484208107,
      "pose_mae_dx": 0.020574694499373436,
      "pose_mae_dy": 0.02794811688363552,
      "pose_rmse_dtheta": 0.18552470207214355,
      "pose_rmse_dx": 0.05601408705115318,
      "pose_rmse_dy": 0.07015296816825867,
      "pose_rmse_mean": 0.10389725863933563,
      "rmse_dtheta": 0.023114852607250214,
      "rmse_dx": 0.004709928296506405,
      "rmse_dy": 0.004882701672613621,
      "rmse_mean": 0.010902494192123413,
      "rotation_flip": 0.005042016971856356,
      "sparse_tokens": 32105.0,
      "step": 8798,
      "turn_loss": 0.07195950299501419,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4087994796506226,
      "grad_norm": 0.39631524682044983,
      "learning_rate": 1.6878901583349838e-06,
      "loss": 0.1146,
      "mae_dtheta": 0.008458439260721207,
      "mae_dx": 0.002444461453706026,
      "mae_dy": 0.001856491551734507,
      "pose_mae_dtheta": 0.049867551773786545,
      "pose_mae_dx": 0.02706255577504635,
      "pose_mae_dy": 0.022107915952801704,
      "pose_rmse_dtheta": 0.1408800482749939,
      "pose_rmse_dx": 0.07284151762723923,
      "pose_rmse_dy": 0.051035959273576736,
      "pose_rmse_mean": 0.08825251460075378,
      "rmse_dtheta": 0.021167432889342308,
      "rmse_dx": 0.008061547763645649,
      "rmse_dy": 0.004433452617377043,
      "rmse_mean": 0.011220811866223812,
      "rotation_flip": 0.005877413786947727,
      "sparse_tokens": 32089.0,
      "step": 8799,
      "turn_loss": 0.11340636759996414,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.40884593941646535,
      "grad_norm": 0.6112346649169922,
      "learning_rate": 1.6868997589213138e-06,
      "loss": 0.221,
      "mae_dtheta": 0.03709835186600685,
      "mae_dx": 0.015774445608258247,
      "mae_dy": 0.008162159472703934,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6112346649169922,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.8438720703125,
      "model/head/act_norm_mean": 98.41060697115384,
      "model/head/act_norm_min": 66.42884826660156,
      "model/head/act_over_embed": 67.62869044519525,
      "model/head/grad_frac": 0.11442030221223831,
      "model/head/grad_norm": 0.06993765383958817,
      "model/head/grad_zero_frac": 0.00021225481759756804,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6872445913461539,
      "model/head/update_ratio": 0.0011910574976354837,
      "model/head/weight_delta": 9.83059024810791,
      "model/head/weight_delta_rel": 0.17245766520500183,
      "model/head/weight_norm": 58.718955993652344,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4225071966648102,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4224418582338275,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4223770201206207,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29030599994127454,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06332223862409592,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03870474919676781,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5174893465909091,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012498225551098585,
      "model/modality_embedder.encoders.pose/weight_delta": 3.126481294631958,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10215188562870026,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968196868896484,
      "model/modality_embedder/grad_frac": 0.06332223862409592,
      "model/modality_embedder/grad_norm": 0.03870474919676781,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5174893465909091,
      "model/modality_embedder/update_ratio": 0.0012498225551098585,
      "model/modality_embedder/weight_delta": 3.126481294631958,
      "model/modality_embedder/weight_delta_rel": 0.10215188562870026,
      "model/modality_embedder/weight_norm": 30.968196868896484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.56312561035156,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.60269764957265,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.30659294128418,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.532785434575688,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10581053048372269,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06467506289482117,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0023145161103457212,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6631665229797363,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09704739600419998,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.943233489990234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.69798278808594,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.40255074786325,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.704590797424316,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.082451972063673,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10941233485937119,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0668766126036644,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002248556585982442,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3760738372802734,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11694983392953873,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.74201774597168,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 76.77064514160156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.024580280830282,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.808310508728027,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.19712585279836,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09953393787145615,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06083859130740166,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019809873774647713,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.653211832046509,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12266801297664642,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.711244583129883,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 77.67752838134766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.956196581196583,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.286641120910645,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.524550658486806,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09170812368392944,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.056055184453725815,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018727764254435897,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1346213817596436,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10712648183107376,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.931594848632812,
      "model/normalizer/grad_frac": 0.3766299784183502,
      "model/normalizer/grad_norm": 0.23020929098129272,
      "model/normalizer/grad_zero_frac": 0.00021389465837273747,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002927919151261449,
      "model/normalizer/weight_delta": 6.604874610900879,
      "model/normalizer/weight_delta_rel": 0.08506695926189423,
      "model/normalizer/weight_norm": 78.62556457519531,
      "pose_mae_dtheta": 0.2520691454410553,
      "pose_mae_dx": 0.11859292536973953,
      "pose_mae_dy": 0.06826483458280563,
      "pose_rmse_dtheta": 0.4417622983455658,
      "pose_rmse_dx": 0.24075472354888916,
      "pose_rmse_dy": 0.1696254312992096,
      "pose_rmse_mean": 0.2840474843978882,
      "rmse_dtheta": 0.05580596625804901,
      "rmse_dx": 0.028904523700475693,
      "rmse_dy": 0.01593359000980854,
      "rmse_mean": 0.0335480272769928,
      "rotation_flip": 0.011594203300774097,
      "sparse_tokens": 17647.0,
      "step": 8800,
      "turn_loss": 0.4058842957019806,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "epoch": 0.40884593941646535,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3046962320804596,
      "eval_objectnav_nopose_mae_dtheta": 0.038848888128995895,
      "eval_objectnav_nopose_mae_dx": 0.012749474495649338,
      "eval_objectnav_nopose_mae_dy": 0.0048850602470338345,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31104615330696106,
      "eval_objectnav_nopose_pose_mae_dx": 0.10031947493553162,
      "eval_objectnav_nopose_pose_mae_dy": 0.05362319201231003,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5281729698181152,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22447353601455688,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1276756078004837,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29344069957733154,
      "eval_objectnav_nopose_rmse_dtheta": 0.05653644725680351,
      "eval_objectnav_nopose_rmse_dx": 0.025283651426434517,
      "eval_objectnav_nopose_rmse_dy": 0.010041664354503155,
      "eval_objectnav_nopose_rmse_mean": 0.03062058798968792,
      "eval_objectnav_nopose_rotation_flip": 0.01440503541380167,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3046962320804596,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 8800
    },
    {
      "epoch": 0.40884593941646535,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27226898074150085,
      "eval_objectnav_pose_mae_dtheta": 0.03460168465971947,
      "eval_objectnav_pose_mae_dx": 0.011092498898506165,
      "eval_objectnav_pose_mae_dy": 0.00451694754883647,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2586791515350342,
      "eval_objectnav_pose_pose_mae_dx": 0.08573390543460846,
      "eval_objectnav_pose_pose_mae_dy": 0.04793727770447731,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45718368887901306,
      "eval_objectnav_pose_pose_rmse_dx": 0.20000992715358734,
      "eval_objectnav_pose_pose_rmse_dy": 0.11546413600444794,
      "eval_objectnav_pose_pose_rmse_mean": 0.2575525939464569,
      "eval_objectnav_pose_rmse_dtheta": 0.05213174223899841,
      "eval_objectnav_pose_rmse_dx": 0.02321021631360054,
      "eval_objectnav_pose_rmse_dy": 0.009493247605860233,
      "eval_objectnav_pose_rmse_mean": 0.028278401121497154,
      "eval_objectnav_pose_rotation_flip": 0.015481662936508656,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27226898074150085,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 8800
    },
    {
      "epoch": 0.40884593941646535,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08915530145168304,
      "eval_pointnav_mae_dtheta": 0.009923556819558144,
      "eval_pointnav_mae_dx": 0.0022251044865697622,
      "eval_pointnav_mae_dy": 0.0022758296690881252,
      "eval_pointnav_pose_mae_dtheta": 0.0676606148481369,
      "eval_pointnav_pose_mae_dx": 0.024193501099944115,
      "eval_pointnav_pose_mae_dy": 0.02427591383457184,
      "eval_pointnav_pose_rmse_dtheta": 0.19787025451660156,
      "eval_pointnav_pose_rmse_dx": 0.07702472805976868,
      "eval_pointnav_pose_rmse_dy": 0.07197858393192291,
      "eval_pointnav_pose_rmse_mean": 0.11562453210353851,
      "eval_pointnav_rmse_dtheta": 0.024843983352184296,
      "eval_pointnav_rmse_dx": 0.007259762845933437,
      "eval_pointnav_rmse_dy": 0.00623400928452611,
      "eval_pointnav_rmse_mean": 0.012779252603650093,
      "eval_pointnav_rotation_flip": 0.004851469304412603,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08915530145168304,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 8800
    },
    {
      "epoch": 0.40884593941646535,
      "eval_loss": 0.22204017142454782,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3046962320804596,
      "eval_objectnav_nopose_mae_dtheta": 0.038848888128995895,
      "eval_objectnav_nopose_mae_dx": 0.012749474495649338,
      "eval_objectnav_nopose_mae_dy": 0.0048850602470338345,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31104615330696106,
      "eval_objectnav_nopose_pose_mae_dx": 0.10031947493553162,
      "eval_objectnav_nopose_pose_mae_dy": 0.05362319201231003,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5281729698181152,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22447353601455688,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1276756078004837,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29344069957733154,
      "eval_objectnav_nopose_rmse_dtheta": 0.05653644725680351,
      "eval_objectnav_nopose_rmse_dx": 0.025283651426434517,
      "eval_objectnav_nopose_rmse_dy": 0.010041664354503155,
      "eval_objectnav_nopose_rmse_mean": 0.03062058798968792,
      "eval_objectnav_nopose_rotation_flip": 0.01440503541380167,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3046962320804596,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27226898074150085,
      "eval_objectnav_pose_mae_dtheta": 0.03460168465971947,
      "eval_objectnav_pose_mae_dx": 0.011092498898506165,
      "eval_objectnav_pose_mae_dy": 0.00451694754883647,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2586791515350342,
      "eval_objectnav_pose_pose_mae_dx": 0.08573390543460846,
      "eval_objectnav_pose_pose_mae_dy": 0.04793727770447731,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45718368887901306,
      "eval_objectnav_pose_pose_rmse_dx": 0.20000992715358734,
      "eval_objectnav_pose_pose_rmse_dy": 0.11546413600444794,
      "eval_objectnav_pose_pose_rmse_mean": 0.2575525939464569,
      "eval_objectnav_pose_rmse_dtheta": 0.05213174223899841,
      "eval_objectnav_pose_rmse_dx": 0.02321021631360054,
      "eval_objectnav_pose_rmse_dy": 0.009493247605860233,
      "eval_objectnav_pose_rmse_mean": 0.028278401121497154,
      "eval_objectnav_pose_rotation_flip": 0.015481662936508656,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27226898074150085,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08915530145168304,
      "eval_pointnav_mae_dtheta": 0.009923556819558144,
      "eval_pointnav_mae_dx": 0.0022251044865697622,
      "eval_pointnav_mae_dy": 0.0022758296690881252,
      "eval_pointnav_pose_mae_dtheta": 0.0676606148481369,
      "eval_pointnav_pose_mae_dx": 0.024193501099944115,
      "eval_pointnav_pose_mae_dy": 0.02427591383457184,
      "eval_pointnav_pose_rmse_dtheta": 0.19787025451660156,
      "eval_pointnav_pose_rmse_dx": 0.07702472805976868,
      "eval_pointnav_pose_rmse_dy": 0.07197858393192291,
      "eval_pointnav_pose_rmse_mean": 0.11562453210353851,
      "eval_pointnav_rmse_dtheta": 0.024843983352184296,
      "eval_pointnav_rmse_dx": 0.007259762845933437,
      "eval_pointnav_rmse_dy": 0.00623400928452611,
      "eval_pointnav_rmse_mean": 0.012779252603650093,
      "eval_pointnav_rotation_flip": 0.004851469304412603,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08915530145168304,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 8800
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.40889239918230813,
      "grad_norm": 0.44309988617897034,
      "learning_rate": 1.68590959119452e-06,
      "loss": 0.0612,
      "mae_dtheta": 0.00831288006156683,
      "mae_dx": 0.0013520823558792472,
      "mae_dy": 0.0013666581362485886,
      "pose_mae_dtheta": 0.05622384324669838,
      "pose_mae_dx": 0.014432801865041256,
      "pose_mae_dy": 0.018107622861862183,
      "pose_rmse_dtheta": 0.17299003899097443,
      "pose_rmse_dx": 0.04501514136791229,
      "pose_rmse_dy": 0.052643194794654846,
      "pose_rmse_mean": 0.09021612256765366,
      "rmse_dtheta": 0.022361919283866882,
      "rmse_dx": 0.004727454856038094,
      "rmse_dy": 0.003925333730876446,
      "rmse_mean": 0.010338235646486282,
      "rotation_flip": 0.004856988787651062,
      "sparse_tokens": 32073.0,
      "step": 8801,
      "turn_loss": 0.0651843324303627,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.4089388589481509,
      "grad_norm": 0.7491723299026489,
      "learning_rate": 1.6849196552238473e-06,
      "loss": 0.1613,
      "mae_dtheta": 0.025294100865721703,
      "mae_dx": 0.004645570646971464,
      "mae_dy": 0.004487599246203899,
      "pose_mae_dtheta": 0.18365763127803802,
      "pose_mae_dx": 0.0498354509472847,
      "pose_mae_dy": 0.03376585617661476,
      "pose_rmse_dtheta": 0.3809429705142975,
      "pose_rmse_dx": 0.13742056488990784,
      "pose_rmse_dy": 0.07609850913286209,
      "pose_rmse_mean": 0.198154017329216,
      "rmse_dtheta": 0.04263586178421974,
      "rmse_dx": 0.012701645493507385,
      "rmse_dy": 0.009622450917959213,
      "rmse_mean": 0.021653320640325546,
      "rotation_flip": 0.03682170435786247,
      "sparse_tokens": 8528.0,
      "step": 8802,
      "turn_loss": 0.22441507875919342,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4089853187139937,
      "grad_norm": 0.6420401334762573,
      "learning_rate": 1.683929951078524e-06,
      "loss": 0.1294,
      "mae_dtheta": 0.008256993256509304,
      "mae_dx": 0.0012019367422908545,
      "mae_dy": 0.001464430009946227,
      "pose_mae_dtheta": 0.06013668701052666,
      "pose_mae_dx": 0.014691309072077274,
      "pose_mae_dy": 0.02442040666937828,
      "pose_rmse_dtheta": 0.15037713944911957,
      "pose_rmse_dx": 0.046571988612413406,
      "pose_rmse_dy": 0.065174400806427,
      "pose_rmse_mean": 0.08737450838088989,
      "rmse_dtheta": 0.01921846903860569,
      "rmse_dx": 0.005213298834860325,
      "rmse_dy": 0.0033980596344918013,
      "rmse_mean": 0.009276609867811203,
      "rotation_flip": 0.004697286058217287,
      "sparse_tokens": 32057.0,
      "step": 8803,
      "turn_loss": 0.06037299707531929,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.40903177847983646,
      "grad_norm": 0.475756973028183,
      "learning_rate": 1.6829404788277575e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.027250956743955612,
      "mae_dx": 0.00625206483528018,
      "mae_dy": 0.0038252638187259436,
      "pose_mae_dtheta": 0.21319614350795746,
      "pose_mae_dx": 0.06061532720923424,
      "pose_mae_dy": 0.060451604425907135,
      "pose_rmse_dtheta": 0.388718843460083,
      "pose_rmse_dx": 0.1398189812898636,
      "pose_rmse_dy": 0.15001171827316284,
      "pose_rmse_mean": 0.22618317604064941,
      "rmse_dtheta": 0.04400642588734627,
      "rmse_dx": 0.015976963564753532,
      "rmse_dy": 0.007224896922707558,
      "rmse_mean": 0.02240276150405407,
      "rotation_flip": 0.017467249184846878,
      "sparse_tokens": 7697.0,
      "step": 8804,
      "turn_loss": 0.22279168665409088,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.40907823824567924,
      "grad_norm": 0.5598543882369995,
      "learning_rate": 1.6819512385407455e-06,
      "loss": 0.1153,
      "mae_dtheta": 0.030303215608000755,
      "mae_dx": 0.008620488457381725,
      "mae_dy": 0.003684924216940999,
      "pose_mae_dtheta": 0.2414962351322174,
      "pose_mae_dx": 0.070249542593956,
      "pose_mae_dy": 0.04122108593583107,
      "pose_rmse_dtheta": 0.4212944805622101,
      "pose_rmse_dx": 0.16124437749385834,
      "pose_rmse_dy": 0.10711408406496048,
      "pose_rmse_mean": 0.2298843115568161,
      "rmse_dtheta": 0.04739207774400711,
      "rmse_dx": 0.019615303725004196,
      "rmse_dy": 0.007787773851305246,
      "rmse_mean": 0.024931717664003372,
      "rotation_flip": 0.015804598107933998,
      "sparse_tokens": 12422.0,
      "step": 8805,
      "turn_loss": 0.18433412909507751,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.409124698011522,
      "grad_norm": 0.7545997500419617,
      "learning_rate": 1.6809622302866623e-06,
      "loss": 0.1614,
      "mae_dtheta": 0.03373429924249649,
      "mae_dx": 0.01354445330798626,
      "mae_dy": 0.004697841126471758,
      "pose_mae_dtheta": 0.2518233358860016,
      "pose_mae_dx": 0.10600035637617111,
      "pose_mae_dy": 0.06176868453621864,
      "pose_rmse_dtheta": 0.37765318155288696,
      "pose_rmse_dx": 0.1961674690246582,
      "pose_rmse_dy": 0.13202035427093506,
      "pose_rmse_mean": 0.2352803349494934,
      "rmse_dtheta": 0.046753399074077606,
      "rmse_dx": 0.02426491118967533,
      "rmse_dy": 0.008673667907714844,
      "rmse_mean": 0.026563992723822594,
      "rotation_flip": 0.020942408591508865,
      "sparse_tokens": 7879.0,
      "step": 8806,
      "turn_loss": 0.25610676407814026,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.4091711577773648,
      "grad_norm": 0.7810035943984985,
      "learning_rate": 1.679973454134674e-06,
      "loss": 0.1591,
      "mae_dtheta": 0.027354896068572998,
      "mae_dx": 0.015204599127173424,
      "mae_dy": 0.008726238273084164,
      "pose_mae_dtheta": 0.18206261098384857,
      "pose_mae_dx": 0.10600054264068604,
      "pose_mae_dy": 0.12127751111984253,
      "pose_rmse_dtheta": 0.3165353238582611,
      "pose_rmse_dx": 0.22877737879753113,
      "pose_rmse_dy": 0.26584869623184204,
      "pose_rmse_mean": 0.2703871428966522,
      "rmse_dtheta": 0.042026691138744354,
      "rmse_dx": 0.028503984212875366,
      "rmse_dy": 0.01508696936070919,
      "rmse_mean": 0.02853921614587307,
      "rotation_flip": 0.00913241971284151,
      "sparse_tokens": 7879.0,
      "step": 8807,
      "turn_loss": 0.24025259912014008,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.40921761754320757,
      "grad_norm": 0.5358631610870361,
      "learning_rate": 1.6789849101539218e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.012081491760909557,
      "mae_dx": 0.0022369185462594032,
      "mae_dy": 0.003275357186794281,
      "pose_mae_dtheta": 0.0768667533993721,
      "pose_mae_dx": 0.02975156530737877,
      "pose_mae_dy": 0.03686612844467163,
      "pose_rmse_dtheta": 0.16667382419109344,
      "pose_rmse_dx": 0.0814259946346283,
      "pose_rmse_dy": 0.0852091908454895,
      "pose_rmse_mean": 0.11110299825668335,
      "rmse_dtheta": 0.024271078407764435,
      "rmse_dx": 0.007378187496215105,
      "rmse_dy": 0.006994089111685753,
      "rmse_mean": 0.01288111787289381,
      "rotation_flip": 0.009931719861924648,
      "sparse_tokens": 32137.0,
      "step": 8808,
      "turn_loss": 0.10345009714365005,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40926407730905034,
      "grad_norm": 0.5028460621833801,
      "learning_rate": 1.6779965984135376e-06,
      "loss": 0.1112,
      "mae_dtheta": 0.009108169935643673,
      "mae_dx": 0.002016033511608839,
      "mae_dy": 0.0024573870468884706,
      "pose_mae_dtheta": 0.060113754123449326,
      "pose_mae_dx": 0.025061676278710365,
      "pose_mae_dy": 0.026767095550894737,
      "pose_rmse_dtheta": 0.14864009618759155,
      "pose_rmse_dx": 0.07563752681016922,
      "pose_rmse_dy": 0.06942150741815567,
      "pose_rmse_mean": 0.09789970517158508,
      "rmse_dtheta": 0.02007376402616501,
      "rmse_dx": 0.005987547338008881,
      "rmse_dy": 0.00643625482916832,
      "rmse_mean": 0.010832522064447403,
      "rotation_flip": 0.009631490334868431,
      "sparse_tokens": 32105.0,
      "step": 8809,
      "turn_loss": 0.08289791643619537,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4093105370748931,
      "grad_norm": 0.6487715244293213,
      "learning_rate": 1.6770085189826363e-06,
      "loss": 0.1164,
      "mae_dtheta": 0.008662221021950245,
      "mae_dx": 0.001559081836603582,
      "mae_dy": 0.0017353508155792952,
      "pose_mae_dtheta": 0.05761661008000374,
      "pose_mae_dx": 0.018491504713892937,
      "pose_mae_dy": 0.02236686274409294,
      "pose_rmse_dtheta": 0.13638558983802795,
      "pose_rmse_dx": 0.048670947551727295,
      "pose_rmse_dy": 0.05854743719100952,
      "pose_rmse_mean": 0.08120132982730865,
      "rmse_dtheta": 0.019454747438430786,
      "rmse_dx": 0.004838058724999428,
      "rmse_dy": 0.003696518950164318,
      "rmse_mean": 0.009329775348305702,
      "rotation_flip": 0.0036529679782688618,
      "sparse_tokens": 32073.0,
      "step": 8810,
      "turn_loss": 0.07074181735515594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13605.0,
      "epoch": 0.4093569968407359,
      "grad_norm": 0.6875588893890381,
      "learning_rate": 1.6760206719303107e-06,
      "loss": 0.1537,
      "mae_dtheta": 0.035209525376558304,
      "mae_dx": 0.008694581687450409,
      "mae_dy": 0.004295450169593096,
      "pose_mae_dtheta": 0.2768303453922272,
      "pose_mae_dx": 0.07474206387996674,
      "pose_mae_dy": 0.05424683168530464,
      "pose_rmse_dtheta": 0.5253960490226746,
      "pose_rmse_dx": 0.1984788328409195,
      "pose_rmse_dy": 0.13034063577651978,
      "pose_rmse_mean": 0.2847385108470917,
      "rmse_dtheta": 0.05636671558022499,
      "rmse_dx": 0.02147573046386242,
      "rmse_dy": 0.008171162568032742,
      "rmse_mean": 0.028671203181147575,
      "rotation_flip": 0.010733452625572681,
      "sparse_tokens": 10384.0,
      "step": 8811,
      "turn_loss": 0.23488719761371613,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 36226.0,
      "epoch": 0.4094034566065787,
      "grad_norm": 0.4200957119464874,
      "learning_rate": 1.6750330573256452e-06,
      "loss": 0.1501,
      "mae_dtheta": 0.03800323233008385,
      "mae_dx": 0.013952773064374924,
      "mae_dy": 0.005729950964450836,
      "pose_mae_dtheta": 0.3076093792915344,
      "pose_mae_dx": 0.10300698131322861,
      "pose_mae_dy": 0.06567125022411346,
      "pose_rmse_dtheta": 0.5330258011817932,
      "pose_rmse_dx": 0.22122958302497864,
      "pose_rmse_dy": 0.17054855823516846,
      "pose_rmse_mean": 0.3082680106163025,
      "rmse_dtheta": 0.056639254093170166,
      "rmse_dx": 0.02629413828253746,
      "rmse_dy": 0.012900867499411106,
      "rmse_mean": 0.03194475546479225,
      "rotation_flip": 0.011869436129927635,
      "sparse_tokens": 29209.0,
      "step": 8812,
      "turn_loss": 0.3035680949687958,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 12353.0,
      "epoch": 0.4094499163724215,
      "grad_norm": 0.7117862701416016,
      "learning_rate": 1.674045675237701e-06,
      "loss": 0.1229,
      "mae_dtheta": 0.027311407029628754,
      "mae_dx": 0.01199280098080635,
      "mae_dy": 0.005741048604249954,
      "pose_mae_dtheta": 0.18589697778224945,
      "pose_mae_dx": 0.09909404069185257,
      "pose_mae_dy": 0.05501541495323181,
      "pose_rmse_dtheta": 0.328328937292099,
      "pose_rmse_dx": 0.2343226969242096,
      "pose_rmse_dy": 0.12893585860729218,
      "pose_rmse_mean": 0.23052917420864105,
      "rmse_dtheta": 0.04398437961935997,
      "rmse_dx": 0.02515999972820282,
      "rmse_dy": 0.012428059242665768,
      "rmse_mean": 0.027190815657377243,
      "rotation_flip": 0.01875000074505806,
      "sparse_tokens": 9906.0,
      "step": 8813,
      "turn_loss": 0.33088305592536926,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4094963761382643,
      "grad_norm": 0.533894956111908,
      "learning_rate": 1.6730585257355297e-06,
      "loss": 0.1059,
      "mae_dtheta": 0.012338857166469097,
      "mae_dx": 0.0016112312441691756,
      "mae_dy": 0.0024631773121654987,
      "pose_mae_dtheta": 0.08338360488414764,
      "pose_mae_dx": 0.023741204291582108,
      "pose_mae_dy": 0.027826983481645584,
      "pose_rmse_dtheta": 0.23873871564865112,
      "pose_rmse_dx": 0.06454332172870636,
      "pose_rmse_dy": 0.07058320194482803,
      "pose_rmse_mean": 0.12462174147367477,
      "rmse_dtheta": 0.027974609285593033,
      "rmse_dx": 0.004308693110942841,
      "rmse_dy": 0.005451587960124016,
      "rmse_mean": 0.012578296475112438,
      "rotation_flip": 0.007661290466785431,
      "sparse_tokens": 32105.0,
      "step": 8814,
      "turn_loss": 0.0848860815167427,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 47713.0,
      "epoch": 0.40954283590410706,
      "grad_norm": 0.48409804701805115,
      "learning_rate": 1.6720716088881595e-06,
      "loss": 0.164,
      "mae_dtheta": 0.04099182412028313,
      "mae_dx": 0.00834421906620264,
      "mae_dy": 0.002982900943607092,
      "pose_mae_dtheta": 0.32352587580680847,
      "pose_mae_dx": 0.06554703414440155,
      "pose_mae_dy": 0.03204632177948952,
      "pose_rmse_dtheta": 0.5542341470718384,
      "pose_rmse_dx": 0.1598842740058899,
      "pose_rmse_dy": 0.08838632702827454,
      "pose_rmse_mean": 0.2675015926361084,
      "rmse_dtheta": 0.06029852107167244,
      "rmse_dx": 0.018946664407849312,
      "rmse_dy": 0.007758594583719969,
      "rmse_mean": 0.02900126203894615,
      "rotation_flip": 0.014551334083080292,
      "sparse_tokens": 30613.0,
      "step": 8815,
      "turn_loss": 0.27690932154655457,
      "turns": 147.0,
      "turns_per_sample": 147.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.40958929566994984,
      "grad_norm": 0.3048507571220398,
      "learning_rate": 1.6710849247646083e-06,
      "loss": 0.0951,
      "mae_dtheta": 0.009021987207233906,
      "mae_dx": 0.002439588075503707,
      "mae_dy": 0.0029050318989902735,
      "pose_mae_dtheta": 0.05966458097100258,
      "pose_mae_dx": 0.02298005484044552,
      "pose_mae_dy": 0.02518652379512787,
      "pose_rmse_dtheta": 0.1485411822795868,
      "pose_rmse_dx": 0.06556044518947601,
      "pose_rmse_dy": 0.06999165564775467,
      "pose_rmse_mean": 0.09469776600599289,
      "rmse_dtheta": 0.020362280309200287,
      "rmse_dx": 0.008462725207209587,
      "rmse_dy": 0.008558016270399094,
      "rmse_mean": 0.01246100664138794,
      "rotation_flip": 0.006533436011523008,
      "sparse_tokens": 32153.0,
      "step": 8816,
      "turn_loss": 0.09160494804382324,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.4096357554357926,
      "grad_norm": 0.5536684989929199,
      "learning_rate": 1.6700984734338765e-06,
      "loss": 0.1328,
      "mae_dtheta": 0.01880004070699215,
      "mae_dx": 0.005598000250756741,
      "mae_dy": 0.004498627036809921,
      "pose_mae_dtheta": 0.12395285069942474,
      "pose_mae_dx": 0.04641009122133255,
      "pose_mae_dy": 0.05763585492968559,
      "pose_rmse_dtheta": 0.25319764018058777,
      "pose_rmse_dx": 0.1107473373413086,
      "pose_rmse_dy": 0.12232997268438339,
      "pose_rmse_mean": 0.16209165751934052,
      "rmse_dtheta": 0.034679900854825974,
      "rmse_dx": 0.015416698530316353,
      "rmse_dy": 0.00880204513669014,
      "rmse_mean": 0.019632883369922638,
      "rotation_flip": 0.007181328721344471,
      "sparse_tokens": 12006.0,
      "step": 8817,
      "turn_loss": 0.1532219499349594,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4096822152016354,
      "grad_norm": 0.306343674659729,
      "learning_rate": 1.6691122549649442e-06,
      "loss": 0.0747,
      "mae_dtheta": 0.0071088518016040325,
      "mae_dx": 0.0018736673519015312,
      "mae_dy": 0.0014370663557201624,
      "pose_mae_dtheta": 0.05353980138897896,
      "pose_mae_dx": 0.016726480796933174,
      "pose_mae_dy": 0.018256202340126038,
      "pose_rmse_dtheta": 0.16494669020175934,
      "pose_rmse_dx": 0.0494227260351181,
      "pose_rmse_dy": 0.05506104975938797,
      "pose_rmse_mean": 0.08981015533208847,
      "rmse_dtheta": 0.018957482650876045,
      "rmse_dx": 0.006541311740875244,
      "rmse_dy": 0.004378937184810638,
      "rmse_mean": 0.009959244169294834,
      "rotation_flip": 0.0036668411921709776,
      "sparse_tokens": 32089.0,
      "step": 8818,
      "turn_loss": 0.07054668664932251,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.40972867496747817,
      "grad_norm": 0.6493644118309021,
      "learning_rate": 1.6681262694267808e-06,
      "loss": 0.1604,
      "mae_dtheta": 0.041024066507816315,
      "mae_dx": 0.013488785363733768,
      "mae_dy": 0.004513072781264782,
      "pose_mae_dtheta": 0.31581857800483704,
      "pose_mae_dx": 0.1063612774014473,
      "pose_mae_dy": 0.06159227341413498,
      "pose_rmse_dtheta": 0.5426009297370911,
      "pose_rmse_dx": 0.23532390594482422,
      "pose_rmse_dy": 0.12753212451934814,
      "pose_rmse_mean": 0.30181899666786194,
      "rmse_dtheta": 0.05846230313181877,
      "rmse_dx": 0.02674063667654991,
      "rmse_dy": 0.007713913451880217,
      "rmse_mean": 0.030972285196185112,
      "rotation_flip": 0.021596243605017662,
      "sparse_tokens": 18293.0,
      "step": 8819,
      "turn_loss": 0.2919345796108246,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.40977513473332094,
      "grad_norm": 0.5884129405021667,
      "learning_rate": 1.6671405168883348e-06,
      "loss": 0.1647,
      "mae_dtheta": 0.04117155075073242,
      "mae_dx": 0.01399372797459364,
      "mae_dy": 0.002283691894263029,
      "pose_mae_dtheta": 0.344973623752594,
      "pose_mae_dx": 0.10923612862825394,
      "pose_mae_dy": 0.026201939210295677,
      "pose_rmse_dtheta": 0.5488156080245972,
      "pose_rmse_dx": 0.23599667847156525,
      "pose_rmse_dy": 0.057869330048561096,
      "pose_rmse_mean": 0.28089386224746704,
      "rmse_dtheta": 0.05790555104613304,
      "rmse_dx": 0.026214776560664177,
      "rmse_dy": 0.0049204411916434765,
      "rmse_mean": 0.02968025580048561,
      "rotation_flip": 0.006319115404039621,
      "sparse_tokens": 20528.0,
      "step": 8820,
      "turn_loss": 0.2786550521850586,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4098215944991637,
      "grad_norm": 0.5278915166854858,
      "learning_rate": 1.6661549974185426e-06,
      "loss": 0.0928,
      "mae_dtheta": 0.011468108743429184,
      "mae_dx": 0.0014152099611237645,
      "mae_dy": 0.00254841148853302,
      "pose_mae_dtheta": 0.0768117681145668,
      "pose_mae_dx": 0.019933046773076057,
      "pose_mae_dy": 0.03054267354309559,
      "pose_rmse_dtheta": 0.20904120802879333,
      "pose_rmse_dx": 0.049875885248184204,
      "pose_rmse_dy": 0.07170088589191437,
      "pose_rmse_mean": 0.1102059930562973,
      "rmse_dtheta": 0.02522464655339718,
      "rmse_dx": 0.003596189199015498,
      "rmse_dy": 0.005287386942654848,
      "rmse_mean": 0.011369407176971436,
      "rotation_flip": 0.005149330478161573,
      "sparse_tokens": 32105.0,
      "step": 8821,
      "turn_loss": 0.09951716661453247,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4098680542650065,
      "grad_norm": 0.5725836753845215,
      "learning_rate": 1.665169711086319e-06,
      "loss": 0.113,
      "mae_dtheta": 0.005897157359868288,
      "mae_dx": 0.0011118502588942647,
      "mae_dy": 0.0007128725992515683,
      "pose_mae_dtheta": 0.04278739169239998,
      "pose_mae_dx": 0.011236404068768024,
      "pose_mae_dy": 0.01124644186347723,
      "pose_rmse_dtheta": 0.15743659436702728,
      "pose_rmse_dx": 0.02757919952273369,
      "pose_rmse_dy": 0.037832148373126984,
      "pose_rmse_mean": 0.07428264617919922,
      "rmse_dtheta": 0.018660912290215492,
      "rmse_dx": 0.003015471389517188,
      "rmse_dy": 0.0020564962178468704,
      "rmse_mean": 0.007910960353910923,
      "rotation_flip": 0.002289377385750413,
      "sparse_tokens": 32201.0,
      "step": 8822,
      "turn_loss": 0.046005308628082275,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4099145140308493,
      "grad_norm": 0.37547773122787476,
      "learning_rate": 1.6641846579605693e-06,
      "loss": 0.0674,
      "mae_dtheta": 0.005468157120049,
      "mae_dx": 0.0011984611628577113,
      "mae_dy": 0.0011640841839835048,
      "pose_mae_dtheta": 0.036174215376377106,
      "pose_mae_dx": 0.012373167090117931,
      "pose_mae_dy": 0.013740578666329384,
      "pose_rmse_dtheta": 0.1015240028500557,
      "pose_rmse_dx": 0.04297509044408798,
      "pose_rmse_dy": 0.03932174667716026,
      "pose_rmse_mean": 0.061273615807294846,
      "rmse_dtheta": 0.014984149485826492,
      "rmse_dx": 0.0045064473524689674,
      "rmse_dy": 0.0031768258195370436,
      "rmse_mean": 0.007555807009339333,
      "rotation_flip": 0.0034083162900060415,
      "sparse_tokens": 32057.0,
      "step": 8823,
      "turn_loss": 0.05212493985891342,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.40996097379669205,
      "grad_norm": 0.4076601266860962,
      "learning_rate": 1.6631998381101766e-06,
      "loss": 0.0933,
      "mae_dtheta": 0.006385129876434803,
      "mae_dx": 0.0011591714574024081,
      "mae_dy": 0.0014511001063510776,
      "pose_mae_dtheta": 0.038393519818782806,
      "pose_mae_dx": 0.010710110887885094,
      "pose_mae_dy": 0.016109704971313477,
      "pose_rmse_dtheta": 0.10531733185052872,
      "pose_rmse_dx": 0.029113175347447395,
      "pose_rmse_dy": 0.04186824709177017,
      "pose_rmse_mean": 0.058766257017850876,
      "rmse_dtheta": 0.01645313762128353,
      "rmse_dx": 0.0036801889073103666,
      "rmse_dy": 0.004043190274387598,
      "rmse_mean": 0.008058838546276093,
      "rotation_flip": 0.002426006831228733,
      "sparse_tokens": 32105.0,
      "step": 8824,
      "turn_loss": 0.060286302119493484,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17859.0,
      "epoch": 0.41000743356253483,
      "grad_norm": 1.053908348083496,
      "learning_rate": 1.6622152516040091e-06,
      "loss": 0.2054,
      "mae_dtheta": 0.029468605294823647,
      "mae_dx": 0.008339118212461472,
      "mae_dy": 0.002482592361047864,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999991655349731,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 146.9786376953125,
      "model/head/act_norm_mean": 101.65985440340908,
      "model/head/act_norm_min": 72.77352905273438,
      "model/head/act_over_embed": 69.86160370057479,
      "model/head/grad_frac": 0.10060195624828339,
      "model/head/grad_norm": 0.10060187429189682,
      "model/head/grad_zero_frac": 0.00019988120766356587,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6911221590909091,
      "model/head/update_ratio": 0.0017132615903392434,
      "model/head/weight_delta": 9.83443832397461,
      "model/head/weight_delta_rel": 0.17252518236637115,
      "model/head/weight_norm": 58.719505310058594,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42251163721084595,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4224467618124826,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4223875105381012,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2903093697264343,
      "model/modality_embedder.encoders.pose/grad_frac": 0.16284392774105072,
      "model/modality_embedder.encoders.pose/grad_norm": 0.16284379363059998,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5322265625,
      "model/modality_embedder.encoders.pose/update_ratio": 0.005258411169052124,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1278274059295654,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1021958664059639,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968250274658203,
      "model/modality_embedder/grad_frac": 0.16284392774105072,
      "model/modality_embedder/grad_norm": 0.16284379363059998,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5322265625,
      "model/modality_embedder/update_ratio": 0.005258411169052124,
      "model/modality_embedder/weight_delta": 3.1278274059295654,
      "model/modality_embedder/weight_delta_rel": 0.1021958664059639,
      "model/modality_embedder/weight_norm": 30.968250274658203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.6686019897461,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.841384830447332,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.112870216369629,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.696813499897363,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06661666184663773,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06661660969257355,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0023839683271944523,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6649374961853027,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09711193293333054,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.943578720092773,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 75.53136444091797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.689862914862914,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.723855018615723,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.27989558308473,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06575498729944229,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06575493514537811,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0022107926197350025,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3786325454711914,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11703847348690033,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.74269676208496,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 77.179931640625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.382280393217894,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.121421813964844,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.44294071887234,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06294117122888565,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06294111907482147,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002975710085593164,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0020493916235864162,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.655874729156494,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1227574273943901,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.712100982666016,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 77.23782348632812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.210082972582974,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.841788291931152,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.69902376356938,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05768850818276405,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05768845975399017,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019273015204817057,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1369712352752686,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.107206791639328,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.93224334716797,
      "model/normalizer/grad_frac": 0.22516830265522003,
      "model/normalizer/grad_norm": 0.2251681089401245,
      "model/normalizer/grad_zero_frac": 0.0002836172061506659,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002863774774596095,
      "model/normalizer/weight_delta": 6.609646797180176,
      "model/normalizer/weight_delta_rel": 0.08512842655181885,
      "model/normalizer/weight_norm": 78.62633514404297,
      "pose_mae_dtheta": 0.23590309917926788,
      "pose_mae_dx": 0.0625791847705841,
      "pose_mae_dy": 0.028620153665542603,
      "pose_rmse_dtheta": 0.4670950770378113,
      "pose_rmse_dx": 0.164911687374115,
      "pose_rmse_dy": 0.07006831467151642,
      "pose_rmse_mean": 0.2340250313282013,
      "rmse_dtheta": 0.04973030462861061,
      "rmse_dx": 0.019975263625383377,
      "rmse_dy": 0.005014386493712664,
      "rmse_mean": 0.02490665391087532,
      "rotation_flip": 0.013994910754263401,
      "sparse_tokens": 14428.0,
      "step": 8825,
      "turn_loss": 0.20828402042388916,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 34063.0,
      "epoch": 0.4100538933283776,
      "grad_norm": 0.46275606751441956,
      "learning_rate": 1.6612308985109222e-06,
      "loss": 0.1196,
      "mae_dtheta": 0.03722355514764786,
      "mae_dx": 0.008844656869769096,
      "mae_dy": 0.004360596649348736,
      "pose_mae_dtheta": 0.28156059980392456,
      "pose_mae_dx": 0.0777834877371788,
      "pose_mae_dy": 0.04852622002363205,
      "pose_rmse_dtheta": 0.5085755586624146,
      "pose_rmse_dx": 0.17471273243427277,
      "pose_rmse_dy": 0.12698772549629211,
      "pose_rmse_mean": 0.2700920104980469,
      "rmse_dtheta": 0.05796182528138161,
      "rmse_dx": 0.019678840413689613,
      "rmse_dy": 0.010746946558356285,
      "rmse_mean": 0.0294625386595726,
      "rotation_flip": 0.011830635368824005,
      "sparse_tokens": 25730.0,
      "step": 8826,
      "turn_loss": 0.29441776871681213,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4101003530942204,
      "grad_norm": 0.4715496599674225,
      "learning_rate": 1.6602467788997483e-06,
      "loss": 0.1113,
      "mae_dtheta": 0.013230683282017708,
      "mae_dx": 0.002556744497269392,
      "mae_dy": 0.0031730923801660538,
      "pose_mae_dtheta": 0.09107469022274017,
      "pose_mae_dx": 0.03424418345093727,
      "pose_mae_dy": 0.0345931351184845,
      "pose_rmse_dtheta": 0.22878573834896088,
      "pose_rmse_dx": 0.09916326403617859,
      "pose_rmse_dy": 0.08677665889263153,
      "pose_rmse_mean": 0.13824188709259033,
      "rmse_dtheta": 0.02756607159972191,
      "rmse_dx": 0.007643232587724924,
      "rmse_dy": 0.0072538526728749275,
      "rmse_mean": 0.014154385775327682,
      "rotation_flip": 0.004517453722655773,
      "sparse_tokens": 32073.0,
      "step": 8827,
      "turn_loss": 0.10247111320495605,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23618.0,
      "epoch": 0.41014681286006316,
      "grad_norm": 0.44315263628959656,
      "learning_rate": 1.6592628928393101e-06,
      "loss": 0.1029,
      "mae_dtheta": 0.030541041865944862,
      "mae_dx": 0.010129719972610474,
      "mae_dy": 0.004958288744091988,
      "pose_mae_dtheta": 0.2176835834980011,
      "pose_mae_dx": 0.08110564202070236,
      "pose_mae_dy": 0.06360265612602234,
      "pose_rmse_dtheta": 0.3768020272254944,
      "pose_rmse_dx": 0.177430659532547,
      "pose_rmse_dy": 0.16074281930923462,
      "pose_rmse_mean": 0.23832517862319946,
      "rmse_dtheta": 0.046486664563417435,
      "rmse_dx": 0.021463241428136826,
      "rmse_dy": 0.009503521956503391,
      "rmse_mean": 0.025817809626460075,
      "rotation_flip": 0.019681349396705627,
      "sparse_tokens": 19519.0,
      "step": 8828,
      "turn_loss": 0.19706611335277557,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.410193272625906,
      "grad_norm": 0.43827810883522034,
      "learning_rate": 1.6582792403984127e-06,
      "loss": 0.1071,
      "mae_dtheta": 0.03894020989537239,
      "mae_dx": 0.008895350620150566,
      "mae_dy": 0.00317968986928463,
      "pose_mae_dtheta": 0.34200936555862427,
      "pose_mae_dx": 0.06476043164730072,
      "pose_mae_dy": 0.035287778824567795,
      "pose_rmse_dtheta": 0.5697731375694275,
      "pose_rmse_dx": 0.13139444589614868,
      "pose_rmse_dy": 0.0772797241806984,
      "pose_rmse_mean": 0.2594824433326721,
      "rmse_dtheta": 0.05704716220498085,
      "rmse_dx": 0.018017785623669624,
      "rmse_dy": 0.006854861509054899,
      "rmse_mean": 0.027306605130434036,
      "rotation_flip": 0.013447432778775692,
      "sparse_tokens": 12991.0,
      "step": 8829,
      "turn_loss": 0.3029153347015381,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 24338.0,
      "epoch": 0.41023973239174877,
      "grad_norm": 0.6816787719726562,
      "learning_rate": 1.6572958216458395e-06,
      "loss": 0.1765,
      "mae_dtheta": 0.027771687135100365,
      "mae_dx": 0.0094115249812603,
      "mae_dy": 0.0037224406842142344,
      "pose_mae_dtheta": 0.20795896649360657,
      "pose_mae_dx": 0.06903247535228729,
      "pose_mae_dy": 0.03803763911128044,
      "pose_rmse_dtheta": 0.40263521671295166,
      "pose_rmse_dx": 0.1542946845293045,
      "pose_rmse_dy": 0.10125467926263809,
      "pose_rmse_mean": 0.21939486265182495,
      "rmse_dtheta": 0.04554092511534691,
      "rmse_dx": 0.02032955177128315,
      "rmse_dy": 0.007188085000962019,
      "rmse_mean": 0.02435285411775112,
      "rotation_flip": 0.015693113207817078,
      "sparse_tokens": 18703.0,
      "step": 8830,
      "turn_loss": 0.20432806015014648,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 21680.0,
      "epoch": 0.41028619215759154,
      "grad_norm": 0.425586462020874,
      "learning_rate": 1.6563126366503657e-06,
      "loss": 0.092,
      "mae_dtheta": 0.03259358927607536,
      "mae_dx": 0.011777262203395367,
      "mae_dy": 0.006024691741913557,
      "pose_mae_dtheta": 0.24280475080013275,
      "pose_mae_dx": 0.0923258364200592,
      "pose_mae_dy": 0.08367370814085007,
      "pose_rmse_dtheta": 0.4286268949508667,
      "pose_rmse_dx": 0.21324610710144043,
      "pose_rmse_dy": 0.1991402506828308,
      "pose_rmse_mean": 0.28033775091171265,
      "rmse_dtheta": 0.04799003154039383,
      "rmse_dx": 0.024500103667378426,
      "rmse_dy": 0.012259816750884056,
      "rmse_mean": 0.028249984607100487,
      "rotation_flip": 0.006930693052709103,
      "sparse_tokens": 16820.0,
      "step": 8831,
      "turn_loss": 0.26966381072998047,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.4103326519234343,
      "grad_norm": 0.4400814175605774,
      "learning_rate": 1.655329685480742e-06,
      "loss": 0.1251,
      "mae_dtheta": 0.033783428370952606,
      "mae_dx": 0.011968845501542091,
      "mae_dy": 0.011188367381691933,
      "pose_mae_dtheta": 0.23261240124702454,
      "pose_mae_dx": 0.1062166690826416,
      "pose_mae_dy": 0.11408058553934097,
      "pose_rmse_dtheta": 0.4157610237598419,
      "pose_rmse_dx": 0.2148229479789734,
      "pose_rmse_dy": 0.21688906848430634,
      "pose_rmse_mean": 0.2824910283088684,
      "rmse_dtheta": 0.05028938502073288,
      "rmse_dx": 0.02337733469903469,
      "rmse_dy": 0.018306300044059753,
      "rmse_mean": 0.030657675117254257,
      "rotation_flip": 0.012224938720464706,
      "sparse_tokens": 7142.0,
      "step": 8832,
      "turn_loss": 0.358674556016922,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4103791116892771,
      "grad_norm": 0.3322177529335022,
      "learning_rate": 1.6543469682057105e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.008867615833878517,
      "mae_dx": 0.001050210790708661,
      "mae_dy": 0.0013765887124463916,
      "pose_mae_dtheta": 0.058492518961429596,
      "pose_mae_dx": 0.010653305798768997,
      "pose_mae_dy": 0.020329907536506653,
      "pose_rmse_dtheta": 0.16863533854484558,
      "pose_rmse_dx": 0.02535068802535534,
      "pose_rmse_dy": 0.043953828513622284,
      "pose_rmse_mean": 0.07931329309940338,
      "rmse_dtheta": 0.020808350294828415,
      "rmse_dx": 0.0031299982219934464,
      "rmse_dy": 0.0028626241255551577,
      "rmse_mean": 0.00893365778028965,
      "rotation_flip": 0.00501253129914403,
      "sparse_tokens": 32105.0,
      "step": 8833,
      "turn_loss": 0.06493362039327621,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4886.0,
      "epoch": 0.4104255714551199,
      "grad_norm": 1.2514768838882446,
      "learning_rate": 1.6533644848939895e-06,
      "loss": 0.2245,
      "mae_dtheta": 0.02720506675541401,
      "mae_dx": 0.015541067346930504,
      "mae_dy": 0.00924927368760109,
      "pose_mae_dtheta": 0.18738240003585815,
      "pose_mae_dx": 0.11921417713165283,
      "pose_mae_dy": 0.1392166018486023,
      "pose_rmse_dtheta": 0.30559802055358887,
      "pose_rmse_dx": 0.24088381230831146,
      "pose_rmse_dy": 0.22742609679698944,
      "pose_rmse_mean": 0.25796931982040405,
      "rmse_dtheta": 0.03797405585646629,
      "rmse_dx": 0.02879100851714611,
      "rmse_dy": 0.012921754270792007,
      "rmse_mean": 0.026562273502349854,
      "rotation_flip": 0.008163264952600002,
      "sparse_tokens": 3858.0,
      "step": 8834,
      "turn_loss": 0.26511579751968384,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.41047203122096265,
      "grad_norm": 0.45032811164855957,
      "learning_rate": 1.652382235614286e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.04023106023669243,
      "mae_dx": 0.01136163342744112,
      "mae_dy": 0.003988171461969614,
      "pose_mae_dtheta": 0.33052074909210205,
      "pose_mae_dx": 0.08829426765441895,
      "pose_mae_dy": 0.04824334755539894,
      "pose_rmse_dtheta": 0.5673807859420776,
      "pose_rmse_dx": 0.17387109994888306,
      "pose_rmse_dy": 0.12280145287513733,
      "pose_rmse_mean": 0.28801780939102173,
      "rmse_dtheta": 0.058108728379011154,
      "rmse_dx": 0.022619567811489105,
      "rmse_dy": 0.00956136453896761,
      "rmse_mean": 0.03009655326604843,
      "rotation_flip": 0.013774104416370392,
      "sparse_tokens": 11694.0,
      "step": 8835,
      "turn_loss": 0.3134726285934448,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.41051849098680543,
      "grad_norm": 0.5750700235366821,
      "learning_rate": 1.6514002204352919e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.02425200678408146,
      "mae_dx": 0.011921843513846397,
      "mae_dy": 0.003983623813837767,
      "pose_mae_dtheta": 0.1639309823513031,
      "pose_mae_dx": 0.09232054650783539,
      "pose_mae_dy": 0.043978530913591385,
      "pose_rmse_dtheta": 0.2893868684768677,
      "pose_rmse_dx": 0.19727106392383575,
      "pose_rmse_dy": 0.13069084286689758,
      "pose_rmse_mean": 0.2057829350233078,
      "rmse_dtheta": 0.038091789931058884,
      "rmse_dx": 0.023635348305106163,
      "rmse_dy": 0.009322834201157093,
      "rmse_mean": 0.023683324456214905,
      "rotation_flip": 0.016393441706895828,
      "sparse_tokens": 6371.0,
      "step": 8836,
      "turn_loss": 0.18339461088180542,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.4105649507526482,
      "grad_norm": 0.5690879821777344,
      "learning_rate": 1.6504184394256755e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.03235769644379616,
      "mae_dx": 0.009138114750385284,
      "mae_dy": 0.006420899648219347,
      "pose_mae_dtheta": 0.2408282309770584,
      "pose_mae_dx": 0.07146205753087997,
      "pose_mae_dy": 0.059846214950084686,
      "pose_rmse_dtheta": 0.46082863211631775,
      "pose_rmse_dx": 0.16640843451023102,
      "pose_rmse_dy": 0.137209951877594,
      "pose_rmse_mean": 0.2548156976699829,
      "rmse_dtheta": 0.052417825907468796,
      "rmse_dx": 0.02049151249229908,
      "rmse_dy": 0.013064286671578884,
      "rmse_mean": 0.028657875955104828,
      "rotation_flip": 0.009918846189975739,
      "sparse_tokens": 18970.0,
      "step": 8837,
      "turn_loss": 0.27634570002555847,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.410611410518491,
      "grad_norm": 0.6224732995033264,
      "learning_rate": 1.649436892654097e-06,
      "loss": 0.1083,
      "mae_dtheta": 0.03379825875163078,
      "mae_dx": 0.006545267533510923,
      "mae_dy": 0.004274845588952303,
      "pose_mae_dtheta": 0.29222577810287476,
      "pose_mae_dx": 0.04913666844367981,
      "pose_mae_dy": 0.09571796655654907,
      "pose_rmse_dtheta": 0.49338021874427795,
      "pose_rmse_dx": 0.10884518921375275,
      "pose_rmse_dy": 0.164618119597435,
      "pose_rmse_mean": 0.2556145191192627,
      "rmse_dtheta": 0.04871181771159172,
      "rmse_dx": 0.016063030809164047,
      "rmse_dy": 0.0068437885493040085,
      "rmse_mean": 0.02387288026511669,
      "rotation_flip": 0.0,
      "sparse_tokens": 3311.0,
      "step": 8838,
      "turn_loss": 0.22742104530334473,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.41065787028433376,
      "grad_norm": 0.458339661359787,
      "learning_rate": 1.648455580189194e-06,
      "loss": 0.0866,
      "mae_dtheta": 0.007633632980287075,
      "mae_dx": 0.0016829973319545388,
      "mae_dy": 0.0020263921469449997,
      "pose_mae_dtheta": 0.05030358210206032,
      "pose_mae_dx": 0.014038629829883575,
      "pose_mae_dy": 0.019801191985607147,
      "pose_rmse_dtheta": 0.1261512190103531,
      "pose_rmse_dx": 0.04077631235122681,
      "pose_rmse_dy": 0.04185820743441582,
      "pose_rmse_mean": 0.06959524750709534,
      "rmse_dtheta": 0.018896818161010742,
      "rmse_dx": 0.006630761548876762,
      "rmse_dy": 0.00617352407425642,
      "rmse_mean": 0.010567034594714642,
      "rotation_flip": 0.00542344618588686,
      "sparse_tokens": 32089.0,
      "step": 8839,
      "turn_loss": 0.08863041549921036,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.41070433005017654,
      "grad_norm": 0.38324829936027527,
      "learning_rate": 1.6474745020995903e-06,
      "loss": 0.1001,
      "mae_dtheta": 0.008048652671277523,
      "mae_dx": 0.0015496991109102964,
      "mae_dy": 0.0017901257378980517,
      "pose_mae_dtheta": 0.05625826120376587,
      "pose_mae_dx": 0.017901694402098656,
      "pose_mae_dy": 0.02386704459786415,
      "pose_rmse_dtheta": 0.14570383727550507,
      "pose_rmse_dx": 0.04591256380081177,
      "pose_rmse_dy": 0.06557997316122055,
      "pose_rmse_mean": 0.0857321247458458,
      "rmse_dtheta": 0.01921362243592739,
      "rmse_dx": 0.004731284454464912,
      "rmse_dy": 0.003828546730801463,
      "rmse_mean": 0.009257817640900612,
      "rotation_flip": 0.0018698578933253884,
      "sparse_tokens": 32169.0,
      "step": 8840,
      "turn_loss": 0.0613628551363945,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.4107507898160193,
      "grad_norm": 1.3637841939926147,
      "learning_rate": 1.646493658453896e-06,
      "loss": 0.2307,
      "mae_dtheta": 0.02969653345644474,
      "mae_dx": 0.014150048606097698,
      "mae_dy": 0.0039045847952365875,
      "pose_mae_dtheta": 0.20716987550258636,
      "pose_mae_dx": 0.12022820860147476,
      "pose_mae_dy": 0.047753576189279556,
      "pose_rmse_dtheta": 0.375377357006073,
      "pose_rmse_dx": 0.27341145277023315,
      "pose_rmse_dy": 0.10901636630296707,
      "pose_rmse_mean": 0.2526017427444458,
      "rmse_dtheta": 0.04580369591712952,
      "rmse_dx": 0.02868925780057907,
      "rmse_dy": 0.009769462049007416,
      "rmse_mean": 0.028087472543120384,
      "rotation_flip": 0.01727447286248207,
      "sparse_tokens": 10758.0,
      "step": 8841,
      "turn_loss": 0.27803048491477966,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.4107972495818621,
      "grad_norm": 0.6289629340171814,
      "learning_rate": 1.645513049320699e-06,
      "loss": 0.1207,
      "mae_dtheta": 0.03040345385670662,
      "mae_dx": 0.007377660367637873,
      "mae_dy": 0.007059414871037006,
      "pose_mae_dtheta": 0.23687662184238434,
      "pose_mae_dx": 0.05799341946840286,
      "pose_mae_dy": 0.08152631670236588,
      "pose_rmse_dtheta": 0.4626741111278534,
      "pose_rmse_dx": 0.15002553164958954,
      "pose_rmse_dy": 0.1953263282775879,
      "pose_rmse_mean": 0.26934200525283813,
      "rmse_dtheta": 0.05180981010198593,
      "rmse_dx": 0.018190408125519753,
      "rmse_dy": 0.017485221847891808,
      "rmse_mean": 0.029161814600229263,
      "rotation_flip": 0.011811023578047752,
      "sparse_tokens": 9174.0,
      "step": 8842,
      "turn_loss": 0.3073244094848633,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.41084370934770487,
      "grad_norm": 0.5343649983406067,
      "learning_rate": 1.6445326747685757e-06,
      "loss": 0.073,
      "mae_dtheta": 0.008324242196977139,
      "mae_dx": 0.0012820878764614463,
      "mae_dy": 0.0016259143594652414,
      "pose_mae_dtheta": 0.05775601044297218,
      "pose_mae_dx": 0.016952775418758392,
      "pose_mae_dy": 0.01996426284313202,
      "pose_rmse_dtheta": 0.18915194272994995,
      "pose_rmse_dx": 0.043354641646146774,
      "pose_rmse_dy": 0.051582422107458115,
      "pose_rmse_mean": 0.09469633549451828,
      "rmse_dtheta": 0.019837308675050735,
      "rmse_dx": 0.0032607894390821457,
      "rmse_dy": 0.003606465645134449,
      "rmse_mean": 0.008901521563529968,
      "rotation_flip": 0.0038582952693104744,
      "sparse_tokens": 32169.0,
      "step": 8843,
      "turn_loss": 0.059320420026779175,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.41089016911354764,
      "grad_norm": 0.5877282023429871,
      "learning_rate": 1.6435525348660825e-06,
      "loss": 0.1272,
      "mae_dtheta": 0.008324439637362957,
      "mae_dx": 0.001317088957875967,
      "mae_dy": 0.001403860398568213,
      "pose_mae_dtheta": 0.0577203594148159,
      "pose_mae_dx": 0.016378477215766907,
      "pose_mae_dy": 0.02263849414885044,
      "pose_rmse_dtheta": 0.14706912636756897,
      "pose_rmse_dx": 0.049424417316913605,
      "pose_rmse_dy": 0.06236237287521362,
      "pose_rmse_mean": 0.0862853080034256,
      "rmse_dtheta": 0.019622568041086197,
      "rmse_dx": 0.004804190248250961,
      "rmse_dy": 0.0032217660918831825,
      "rmse_mean": 0.009216174483299255,
      "rotation_flip": 0.005911330226808786,
      "sparse_tokens": 32057.0,
      "step": 8844,
      "turn_loss": 0.05929391458630562,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.4109366288793905,
      "grad_norm": 0.5566206574440002,
      "learning_rate": 1.6425726296817634e-06,
      "loss": 0.1278,
      "mae_dtheta": 0.021997855976223946,
      "mae_dx": 0.009642917662858963,
      "mae_dy": 0.0038000536151230335,
      "pose_mae_dtheta": 0.17585960030555725,
      "pose_mae_dx": 0.08492590487003326,
      "pose_mae_dy": 0.04308150336146355,
      "pose_rmse_dtheta": 0.3474307358264923,
      "pose_rmse_dx": 0.2035742551088333,
      "pose_rmse_dy": 0.08423813432455063,
      "pose_rmse_mean": 0.21174770593643188,
      "rmse_dtheta": 0.03809187561273575,
      "rmse_dx": 0.02147570811212063,
      "rmse_dy": 0.007006152532994747,
      "rmse_mean": 0.022191246971488,
      "rotation_flip": 0.013129102997481823,
      "sparse_tokens": 7794.0,
      "step": 8845,
      "turn_loss": 0.1774015724658966,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.41098308864523325,
      "grad_norm": 0.6289450526237488,
      "learning_rate": 1.6415929592841407e-06,
      "loss": 0.1845,
      "mae_dtheta": 0.029284458607435226,
      "mae_dx": 0.015531031414866447,
      "mae_dy": 0.006166787352412939,
      "pose_mae_dtheta": 0.20771169662475586,
      "pose_mae_dx": 0.10622981190681458,
      "pose_mae_dy": 0.08742153644561768,
      "pose_rmse_dtheta": 0.30463117361068726,
      "pose_rmse_dx": 0.21889881789684296,
      "pose_rmse_dy": 0.16946806013584137,
      "pose_rmse_mean": 0.23099935054779053,
      "rmse_dtheta": 0.03996151685714722,
      "rmse_dx": 0.02795684151351452,
      "rmse_dy": 0.010121036320924759,
      "rmse_mean": 0.02601313218474388,
      "rotation_flip": 0.021459227427840233,
      "sparse_tokens": 8433.0,
      "step": 8846,
      "turn_loss": 0.27472564578056335,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.41102954841107603,
      "grad_norm": 0.37699925899505615,
      "learning_rate": 1.6406135237417248e-06,
      "loss": 0.0947,
      "mae_dtheta": 0.009442680515348911,
      "mae_dx": 0.0021525525953620672,
      "mae_dy": 0.002490290440618992,
      "pose_mae_dtheta": 0.06326889246702194,
      "pose_mae_dx": 0.02616504393517971,
      "pose_mae_dy": 0.026083409786224365,
      "pose_rmse_dtheta": 0.15616610646247864,
      "pose_rmse_dx": 0.07631547003984451,
      "pose_rmse_dy": 0.06266479194164276,
      "pose_rmse_mean": 0.09838211536407471,
      "rmse_dtheta": 0.02120000496506691,
      "rmse_dx": 0.006271322723478079,
      "rmse_dy": 0.006447935476899147,
      "rmse_mean": 0.01130642183125019,
      "rotation_flip": 0.002696456154808402,
      "sparse_tokens": 32121.0,
      "step": 8847,
      "turn_loss": 0.08694494515657425,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35578.0,
      "epoch": 0.4110760081769188,
      "grad_norm": 0.6838045716285706,
      "learning_rate": 1.6396343231230106e-06,
      "loss": 0.1737,
      "mae_dtheta": 0.040026504546403885,
      "mae_dx": 0.015925303101539612,
      "mae_dy": 0.007044666446745396,
      "pose_mae_dtheta": 0.32276126742362976,
      "pose_mae_dx": 0.1273990124464035,
      "pose_mae_dy": 0.07726161181926727,
      "pose_rmse_dtheta": 0.53599613904953,
      "pose_rmse_dx": 0.2591547667980194,
      "pose_rmse_dy": 0.17984162271022797,
      "pose_rmse_mean": 0.32499751448631287,
      "rmse_dtheta": 0.0577206052839756,
      "rmse_dx": 0.02849513106048107,
      "rmse_dy": 0.015710260719060898,
      "rmse_mean": 0.03397533297538757,
      "rotation_flip": 0.013268998824059963,
      "sparse_tokens": 27045.0,
      "step": 8848,
      "turn_loss": 0.3366135358810425,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4111224679427616,
      "grad_norm": 0.4110521674156189,
      "learning_rate": 1.6386553574964691e-06,
      "loss": 0.0873,
      "mae_dtheta": 0.009133625775575638,
      "mae_dx": 0.0019707269966602325,
      "mae_dy": 0.003231270471587777,
      "pose_mae_dtheta": 0.06063596531748772,
      "pose_mae_dx": 0.02612174116075039,
      "pose_mae_dy": 0.027565542608499527,
      "pose_rmse_dtheta": 0.1148238405585289,
      "pose_rmse_dx": 0.07035882025957108,
      "pose_rmse_dy": 0.06334841996431351,
      "pose_rmse_mean": 0.08284369111061096,
      "rmse_dtheta": 0.017087096348404884,
      "rmse_dx": 0.004692025016993284,
      "rmse_dy": 0.007210948970168829,
      "rmse_mean": 0.009663357399404049,
      "rotation_flip": 0.005100306123495102,
      "sparse_tokens": 32169.0,
      "step": 8849,
      "turn_loss": 0.08593844622373581,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.41116892770860436,
      "grad_norm": 0.4168945252895355,
      "learning_rate": 1.637676626930565e-06,
      "loss": 0.0694,
      "mae_dtheta": 0.00783056952059269,
      "mae_dx": 0.001202940009534359,
      "mae_dy": 0.0017365077510476112,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4168945550918579,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 149.11468505859375,
      "model/head/act_norm_mean": 115.1127288510101,
      "model/head/act_norm_min": 81.45912170410156,
      "model/head/act_over_embed": 79.10654496876113,
      "model/head/grad_frac": 0.07836829870939255,
      "model/head/grad_norm": 0.03267131745815277,
      "model/head/grad_zero_frac": 0.0002151102526113391,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7054036458333334,
      "model/head/update_ratio": 0.00055639015045017,
      "model/head/weight_delta": 9.837617874145508,
      "model/head/weight_delta_rel": 0.17258095741271973,
      "model/head/weight_norm": 58.720157623291016,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4225532114505768,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42248211698048677,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42241039872169495,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29033366612888706,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11269792169332504,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04698314890265465,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5330411146313364,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001517153112217784,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1281745433807373,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10220721364021301,
      "model/modality_embedder.encoders.pose/weight_norm": 30.967967987060547,
      "model/modality_embedder/grad_frac": 0.11269792169332504,
      "model/modality_embedder/grad_norm": 0.04698314890265465,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5330411146313364,
      "model/modality_embedder/update_ratio": 0.001517153112217784,
      "model/modality_embedder/weight_delta": 3.1281745433807373,
      "model/modality_embedder/weight_delta_rel": 0.10220721364021301,
      "model/modality_embedder/weight_norm": 30.967967987060547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.58930206298828,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.096270242103575,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.874448776245117,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.559182503209858,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.042028699070215225,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.017521535977721214,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0006270297453738749,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6663641929626465,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09716392308473587,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.943706512451172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.67317962646484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.097387566137566,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.33759593963623,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.24715970089407,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.045445431023836136,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.018945952877402306,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0006369782495312393,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.381014347076416,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11712098121643066,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.743484497070312,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.47362518310547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.921847442680775,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.320050239562988,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.500945608917043,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.04884690046310425,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.020364006981253624,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0006630388670600951,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.658447027206421,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12284380197525024,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.71314239501953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.29227447509766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.628126503126502,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.440425872802734,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.67351655369159,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0635095089673996,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.026476768776774406,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008845500415191054,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1390907764434814,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1072792261838913,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.932472229003906,
      "model/normalizer/grad_frac": 0.2288082242012024,
      "model/normalizer/grad_norm": 0.09538890421390533,
      "model/normalizer/grad_zero_frac": 0.00021389465837273747,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0012131821131333709,
      "model/normalizer/weight_delta": 6.614071846008301,
      "model/normalizer/weight_delta_rel": 0.08518541604280472,
      "model/normalizer/weight_norm": 78.62702941894531,
      "pose_mae_dtheta": 0.05109577625989914,
      "pose_mae_dx": 0.016696887090802193,
      "pose_mae_dy": 0.023193778470158577,
      "pose_rmse_dtheta": 0.10947054624557495,
      "pose_rmse_dx": 0.04481706768274307,
      "pose_rmse_dy": 0.06264854222536087,
      "pose_rmse_mean": 0.07231204956769943,
      "rmse_dtheta": 0.015554822981357574,
      "rmse_dx": 0.004150128923356533,
      "rmse_dy": 0.003651076229289174,
      "rmse_mean": 0.007785343565046787,
      "rotation_flip": 0.0058823530562222,
      "sparse_tokens": 32057.0,
      "step": 8850,
      "turn_loss": 0.06652544438838959,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.41121538747444714,
      "grad_norm": 0.515975832939148,
      "learning_rate": 1.6366981314937374e-06,
      "loss": 0.14,
      "mae_dtheta": 0.011662776581943035,
      "mae_dx": 0.002139376476407051,
      "mae_dy": 0.0027698187623173,
      "pose_mae_dtheta": 0.07500798255205154,
      "pose_mae_dx": 0.01957162842154503,
      "pose_mae_dy": 0.029366279020905495,
      "pose_rmse_dtheta": 0.20046228170394897,
      "pose_rmse_dx": 0.06501656770706177,
      "pose_rmse_dy": 0.07579196989536285,
      "pose_rmse_mean": 0.1137569397687912,
      "rmse_dtheta": 0.026065288111567497,
      "rmse_dx": 0.006651805713772774,
      "rmse_dy": 0.007910353131592274,
      "rmse_mean": 0.013542482629418373,
      "rotation_flip": 0.007017544005066156,
      "sparse_tokens": 32105.0,
      "step": 8851,
      "turn_loss": 0.10284838080406189,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.4112618472402899,
      "grad_norm": 0.490975946187973,
      "learning_rate": 1.635719871254416e-06,
      "loss": 0.1134,
      "mae_dtheta": 0.03523449972271919,
      "mae_dx": 0.009390173479914665,
      "mae_dy": 0.005405731499195099,
      "pose_mae_dtheta": 0.31430232524871826,
      "pose_mae_dx": 0.08382552862167358,
      "pose_mae_dy": 0.08525680750608444,
      "pose_rmse_dtheta": 0.5418142080307007,
      "pose_rmse_dx": 0.2204187512397766,
      "pose_rmse_dy": 0.17543643712997437,
      "pose_rmse_mean": 0.3125564754009247,
      "rmse_dtheta": 0.055254656821489334,
      "rmse_dx": 0.023143572732806206,
      "rmse_dy": 0.00874426867812872,
      "rmse_mean": 0.02904750034213066,
      "rotation_flip": 0.00920245423913002,
      "sparse_tokens": 5431.0,
      "step": 8852,
      "turn_loss": 0.2645847499370575,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.4113083070061327,
      "grad_norm": 0.7127787470817566,
      "learning_rate": 1.6347418462810082e-06,
      "loss": 0.1601,
      "mae_dtheta": 0.048515066504478455,
      "mae_dx": 0.010440604761242867,
      "mae_dy": 0.007747141644358635,
      "pose_mae_dtheta": 0.4008324146270752,
      "pose_mae_dx": 0.0791655108332634,
      "pose_mae_dy": 0.05657472833991051,
      "pose_rmse_dtheta": 0.7037608027458191,
      "pose_rmse_dx": 0.22025948762893677,
      "pose_rmse_dy": 0.13747020065784454,
      "pose_rmse_mean": 0.3538301885128021,
      "rmse_dtheta": 0.07101542502641678,
      "rmse_dx": 0.02222118154168129,
      "rmse_dy": 0.0167723149061203,
      "rmse_mean": 0.036669641733169556,
      "rotation_flip": 0.03105590119957924,
      "sparse_tokens": 6435.0,
      "step": 8853,
      "turn_loss": 0.3525853753089905,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 12027.0,
      "epoch": 0.41135476677197547,
      "grad_norm": 0.48228535056114197,
      "learning_rate": 1.6337640566419095e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.026280196383595467,
      "mae_dx": 0.006548399571329355,
      "mae_dy": 0.0065849232487380505,
      "pose_mae_dtheta": 0.1922004371881485,
      "pose_mae_dx": 0.05197745934128761,
      "pose_mae_dy": 0.08966738730669022,
      "pose_rmse_dtheta": 0.3452179729938507,
      "pose_rmse_dx": 0.14873895049095154,
      "pose_rmse_dy": 0.20192719995975494,
      "pose_rmse_mean": 0.23196136951446533,
      "rmse_dtheta": 0.04251919314265251,
      "rmse_dx": 0.018462583422660828,
      "rmse_dy": 0.01276384387165308,
      "rmse_mean": 0.024581875652074814,
      "rotation_flip": 0.016227180138230324,
      "sparse_tokens": 10227.0,
      "step": 8854,
      "turn_loss": 0.20486359298229218,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 36338.0,
      "epoch": 0.41140122653781824,
      "grad_norm": 0.5257114171981812,
      "learning_rate": 1.6327865024054984e-06,
      "loss": 0.1314,
      "mae_dtheta": 0.023138320073485374,
      "mae_dx": 0.011900302022695541,
      "mae_dy": 0.005398651119321585,
      "pose_mae_dtheta": 0.19629479944705963,
      "pose_mae_dx": 0.09384945034980774,
      "pose_mae_dy": 0.061798952519893646,
      "pose_rmse_dtheta": 0.37636131048202515,
      "pose_rmse_dx": 0.21866095066070557,
      "pose_rmse_dy": 0.15204569697380066,
      "pose_rmse_mean": 0.24902264773845673,
      "rmse_dtheta": 0.039439622312784195,
      "rmse_dx": 0.024835841730237007,
      "rmse_dy": 0.011734778992831707,
      "rmse_mean": 0.025336747989058495,
      "rotation_flip": 0.012977649457752705,
      "sparse_tokens": 27490.0,
      "step": 8855,
      "turn_loss": 0.24324510991573334,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.411447686303661,
      "grad_norm": 0.9656440615653992,
      "learning_rate": 1.6318091836401328e-06,
      "loss": 0.2445,
      "mae_dtheta": 0.0259860809892416,
      "mae_dx": 0.004473153036087751,
      "mae_dy": 0.003916033077985048,
      "pose_mae_dtheta": 0.15580172836780548,
      "pose_mae_dx": 0.026483267545700073,
      "pose_mae_dy": 0.045499373227357864,
      "pose_rmse_dtheta": 0.2765166759490967,
      "pose_rmse_dx": 0.09179627150297165,
      "pose_rmse_dy": 0.10918054729700089,
      "pose_rmse_mean": 0.15916450321674347,
      "rmse_dtheta": 0.04049713537096977,
      "rmse_dx": 0.010279097594320774,
      "rmse_dy": 0.010568063706159592,
      "rmse_mean": 0.020448099821805954,
      "rotation_flip": 0.009740259498357773,
      "sparse_tokens": 5059.0,
      "step": 8856,
      "turn_loss": 0.188370019197464,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 26849.0,
      "epoch": 0.4114941460695038,
      "grad_norm": 0.5861100554466248,
      "learning_rate": 1.6308321004141609e-06,
      "loss": 0.1432,
      "mae_dtheta": 0.03456488996744156,
      "mae_dx": 0.01545634400099516,
      "mae_dy": 0.008465449325740337,
      "pose_mae_dtheta": 0.26448020339012146,
      "pose_mae_dx": 0.11999832838773727,
      "pose_mae_dy": 0.11181274056434631,
      "pose_rmse_dtheta": 0.4496247470378876,
      "pose_rmse_dx": 0.25968098640441895,
      "pose_rmse_dy": 0.22475427389144897,
      "pose_rmse_mean": 0.3113533556461334,
      "rmse_dtheta": 0.04924885183572769,
      "rmse_dx": 0.029540354385972023,
      "rmse_dy": 0.014115891419351101,
      "rmse_mean": 0.03096836619079113,
      "rotation_flip": 0.016194332391023636,
      "sparse_tokens": 22713.0,
      "step": 8857,
      "turn_loss": 0.31439951062202454,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 13928.0,
      "epoch": 0.4115406058353466,
      "grad_norm": 0.5024639368057251,
      "learning_rate": 1.6298552527959066e-06,
      "loss": 0.1285,
      "mae_dtheta": 0.023745663464069366,
      "mae_dx": 0.0067209177650511265,
      "mae_dy": 0.0032875475008040667,
      "pose_mae_dtheta": 0.1896420568227768,
      "pose_mae_dx": 0.05328217148780823,
      "pose_mae_dy": 0.04314720258116722,
      "pose_rmse_dtheta": 0.36200007796287537,
      "pose_rmse_dx": 0.12065314501523972,
      "pose_rmse_dy": 0.09496238082647324,
      "pose_rmse_mean": 0.1925385445356369,
      "rmse_dtheta": 0.039715010672807693,
      "rmse_dx": 0.016074765473604202,
      "rmse_dy": 0.006305609364062548,
      "rmse_mean": 0.020698461681604385,
      "rotation_flip": 0.015306122601032257,
      "sparse_tokens": 11717.0,
      "step": 8858,
      "turn_loss": 0.22654995322227478,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.41158706560118935,
      "grad_norm": 0.5630183219909668,
      "learning_rate": 1.628878640853685e-06,
      "loss": 0.0836,
      "mae_dtheta": 0.005694772116839886,
      "mae_dx": 0.0013203169219195843,
      "mae_dy": 0.000792915525380522,
      "pose_mae_dtheta": 0.03634316846728325,
      "pose_mae_dx": 0.011153210885822773,
      "pose_mae_dy": 0.011903058737516403,
      "pose_rmse_dtheta": 0.09909745305776596,
      "pose_rmse_dx": 0.03373844549059868,
      "pose_rmse_dy": 0.03020944818854332,
      "pose_rmse_mean": 0.054348450154066086,
      "rmse_dtheta": 0.015942493453621864,
      "rmse_dx": 0.004985771141946316,
      "rmse_dy": 0.0018650231650099158,
      "rmse_mean": 0.007597762625664473,
      "rotation_flip": 0.006670709699392319,
      "sparse_tokens": 32089.0,
      "step": 8859,
      "turn_loss": 0.04099748656153679,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19742.0,
      "epoch": 0.4116335253670321,
      "grad_norm": 0.4869628846645355,
      "learning_rate": 1.627902264655788e-06,
      "loss": 0.1268,
      "mae_dtheta": 0.03201056644320488,
      "mae_dx": 0.01029916387051344,
      "mae_dy": 0.004720204044133425,
      "pose_mae_dtheta": 0.243863046169281,
      "pose_mae_dx": 0.08557427674531937,
      "pose_mae_dy": 0.058698367327451706,
      "pose_rmse_dtheta": 0.45508873462677,
      "pose_rmse_dx": 0.19461478292942047,
      "pose_rmse_dy": 0.12844815850257874,
      "pose_rmse_mean": 0.259383887052536,
      "rmse_dtheta": 0.05055250972509384,
      "rmse_dx": 0.021893734112381935,
      "rmse_dy": 0.009258300065994263,
      "rmse_mean": 0.027234848588705063,
      "rotation_flip": 0.007616974879056215,
      "sparse_tokens": 16475.0,
      "step": 8860,
      "turn_loss": 0.22286510467529297,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4116799851328749,
      "grad_norm": 0.4211649000644684,
      "learning_rate": 1.626926124270497e-06,
      "loss": 0.0919,
      "mae_dtheta": 0.012904936447739601,
      "mae_dx": 0.0020788400433957577,
      "mae_dy": 0.004275474231690168,
      "pose_mae_dtheta": 0.08286962658166885,
      "pose_mae_dx": 0.03286953642964363,
      "pose_mae_dy": 0.04027939587831497,
      "pose_rmse_dtheta": 0.16632525622844696,
      "pose_rmse_dx": 0.07750561088323593,
      "pose_rmse_dy": 0.0843702107667923,
      "pose_rmse_mean": 0.10940035432577133,
      "rmse_dtheta": 0.024463625624775887,
      "rmse_dx": 0.005246045533567667,
      "rmse_dy": 0.008627623319625854,
      "rmse_mean": 0.012779098004102707,
      "rotation_flip": 0.007903779856860638,
      "sparse_tokens": 32089.0,
      "step": 8861,
      "turn_loss": 0.12266109138727188,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.41172644489871774,
      "grad_norm": 0.47796645760536194,
      "learning_rate": 1.6259502197660726e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.008802199736237526,
      "mae_dx": 0.0013308129273355007,
      "mae_dy": 0.001946210046298802,
      "pose_mae_dtheta": 0.060994479805231094,
      "pose_mae_dx": 0.01618788205087185,
      "pose_mae_dy": 0.023239310830831528,
      "pose_rmse_dtheta": 0.18129467964172363,
      "pose_rmse_dx": 0.04053032025694847,
      "pose_rmse_dy": 0.052649009972810745,
      "pose_rmse_mean": 0.09149134159088135,
      "rmse_dtheta": 0.02132381498813629,
      "rmse_dx": 0.0046227434650063515,
      "rmse_dy": 0.0044027348048985004,
      "rmse_mean": 0.010116430930793285,
      "rotation_flip": 0.001768346643075347,
      "sparse_tokens": 32073.0,
      "step": 8862,
      "turn_loss": 0.07394339144229889,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4117729046645605,
      "grad_norm": 0.37997356057167053,
      "learning_rate": 1.624974551210759e-06,
      "loss": 0.0897,
      "mae_dtheta": 0.009079080075025558,
      "mae_dx": 0.0012474420946091413,
      "mae_dy": 0.0017004493856802583,
      "pose_mae_dtheta": 0.056717973202466965,
      "pose_mae_dx": 0.01699669472873211,
      "pose_mae_dy": 0.02301894873380661,
      "pose_rmse_dtheta": 0.141051784157753,
      "pose_rmse_dx": 0.04270179942250252,
      "pose_rmse_dy": 0.06034955754876137,
      "pose_rmse_mean": 0.08136771619319916,
      "rmse_dtheta": 0.02067732997238636,
      "rmse_dx": 0.003475748235359788,
      "rmse_dy": 0.0038595842197537422,
      "rmse_mean": 0.009337554685771465,
      "rotation_flip": 0.003585657337680459,
      "sparse_tokens": 32121.0,
      "step": 8863,
      "turn_loss": 0.06162981688976288,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.4118193644304033,
      "grad_norm": 1.0949140787124634,
      "learning_rate": 1.6239991186727877e-06,
      "loss": 0.2605,
      "mae_dtheta": 0.02989078313112259,
      "mae_dx": 0.010360372252762318,
      "mae_dy": 0.008022676222026348,
      "pose_mae_dtheta": 0.2179090678691864,
      "pose_mae_dx": 0.08431178331375122,
      "pose_mae_dy": 0.0866464152932167,
      "pose_rmse_dtheta": 0.4012818932533264,
      "pose_rmse_dx": 0.18853743374347687,
      "pose_rmse_dy": 0.20274287462234497,
      "pose_rmse_mean": 0.26418739557266235,
      "rmse_dtheta": 0.04908834397792816,
      "rmse_dx": 0.022654538974165916,
      "rmse_dy": 0.016454409807920456,
      "rmse_mean": 0.029399096965789795,
      "rotation_flip": 0.013302034698426723,
      "sparse_tokens": 20344.0,
      "step": 8864,
      "turn_loss": 0.2602561116218567,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 36874.0,
      "epoch": 0.41186582419624607,
      "grad_norm": 0.5426514148712158,
      "learning_rate": 1.6230239222203687e-06,
      "loss": 0.1682,
      "mae_dtheta": 0.02850363962352276,
      "mae_dx": 0.011925742961466312,
      "mae_dy": 0.00419268012046814,
      "pose_mae_dtheta": 0.22857096791267395,
      "pose_mae_dx": 0.099086232483387,
      "pose_mae_dy": 0.05001358315348625,
      "pose_rmse_dtheta": 0.4136095345020294,
      "pose_rmse_dx": 0.24295982718467712,
      "pose_rmse_dy": 0.12479638308286667,
      "pose_rmse_mean": 0.26045525074005127,
      "rmse_dtheta": 0.04587927460670471,
      "rmse_dx": 0.02536744624376297,
      "rmse_dy": 0.00834326446056366,
      "rmse_mean": 0.02652999572455883,
      "rotation_flip": 0.011421320028603077,
      "sparse_tokens": 29674.0,
      "step": 8865,
      "turn_loss": 0.2387683242559433,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.41191228396208884,
      "grad_norm": 0.47117292881011963,
      "learning_rate": 1.6220489619216988e-06,
      "loss": 0.1037,
      "mae_dtheta": 0.008283743634819984,
      "mae_dx": 0.0012887903722003102,
      "mae_dy": 0.002117936033755541,
      "pose_mae_dtheta": 0.05321492254734039,
      "pose_mae_dx": 0.013398571871221066,
      "pose_mae_dy": 0.021522339433431625,
      "pose_rmse_dtheta": 0.11419251561164856,
      "pose_rmse_dx": 0.03047310747206211,
      "pose_rmse_dy": 0.050712939351797104,
      "pose_rmse_mean": 0.0651261955499649,
      "rmse_dtheta": 0.017832404002547264,
      "rmse_dx": 0.0037499915342777967,
      "rmse_dy": 0.005188113544136286,
      "rmse_mean": 0.008923502638936043,
      "rotation_flip": 0.009201324544847012,
      "sparse_tokens": 32137.0,
      "step": 8866,
      "turn_loss": 0.07379735261201859,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 41411.0,
      "epoch": 0.4119587437279316,
      "grad_norm": 0.47730833292007446,
      "learning_rate": 1.6210742378449601e-06,
      "loss": 0.1,
      "mae_dtheta": 0.028038684278726578,
      "mae_dx": 0.012060338631272316,
      "mae_dy": 0.0034306820016354322,
      "pose_mae_dtheta": 0.2240145206451416,
      "pose_mae_dx": 0.09767311066389084,
      "pose_mae_dy": 0.04062722995877266,
      "pose_rmse_dtheta": 0.41714856028556824,
      "pose_rmse_dx": 0.23153603076934814,
      "pose_rmse_dy": 0.09397731721401215,
      "pose_rmse_mean": 0.2475539892911911,
      "rmse_dtheta": 0.04627804830670357,
      "rmse_dx": 0.02474134787917137,
      "rmse_dy": 0.006869940087199211,
      "rmse_mean": 0.025963112711906433,
      "rotation_flip": 0.007361963391304016,
      "sparse_tokens": 29501.0,
      "step": 8867,
      "turn_loss": 0.23213425278663635,
      "turns": 128.0,
      "turns_per_sample": 128.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.4120052034937744,
      "grad_norm": 0.7472298741340637,
      "learning_rate": 1.6200997500583122e-06,
      "loss": 0.2739,
      "mae_dtheta": 0.03879034146666527,
      "mae_dx": 0.013924946077167988,
      "mae_dy": 0.005005011800676584,
      "pose_mae_dtheta": 0.32896947860717773,
      "pose_mae_dx": 0.11014392226934433,
      "pose_mae_dy": 0.06407003104686737,
      "pose_rmse_dtheta": 0.574199914932251,
      "pose_rmse_dx": 0.23223306238651276,
      "pose_rmse_dy": 0.1801004856824875,
      "pose_rmse_mean": 0.32884448766708374,
      "rmse_dtheta": 0.05937185138463974,
      "rmse_dx": 0.02662617526948452,
      "rmse_dy": 0.010626940056681633,
      "rmse_mean": 0.03220832347869873,
      "rotation_flip": 0.00932994019240141,
      "sparse_tokens": 20126.0,
      "step": 8868,
      "turn_loss": 0.2734401226043701,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4120516632596172,
      "grad_norm": 0.6378985047340393,
      "learning_rate": 1.6191254986299044e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.01232060045003891,
      "mae_dx": 0.002236016793176532,
      "mae_dy": 0.0029402170330286026,
      "pose_mae_dtheta": 0.08436227589845657,
      "pose_mae_dx": 0.02733890898525715,
      "pose_mae_dy": 0.027820125222206116,
      "pose_rmse_dtheta": 0.237745463848114,
      "pose_rmse_dx": 0.08148480951786041,
      "pose_rmse_dy": 0.06563684344291687,
      "pose_rmse_mean": 0.12828904390335083,
      "rmse_dtheta": 0.028860457241535187,
      "rmse_dx": 0.006263264454901218,
      "rmse_dy": 0.00736864423379302,
      "rmse_mean": 0.014164121821522713,
      "rotation_flip": 0.0020981954876333475,
      "sparse_tokens": 32105.0,
      "step": 8869,
      "turn_loss": 0.10266515612602234,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33637.0,
      "epoch": 0.41209812302545995,
      "grad_norm": 0.5780450701713562,
      "learning_rate": 1.6181514836278633e-06,
      "loss": 0.1674,
      "mae_dtheta": 0.03347749635577202,
      "mae_dx": 0.014454777352511883,
      "mae_dy": 0.005156693514436483,
      "pose_mae_dtheta": 0.2707113027572632,
      "pose_mae_dx": 0.1200140044093132,
      "pose_mae_dy": 0.06358986347913742,
      "pose_rmse_dtheta": 0.464621901512146,
      "pose_rmse_dx": 0.25623947381973267,
      "pose_rmse_dy": 0.14298000931739807,
      "pose_rmse_mean": 0.2879471480846405,
      "rmse_dtheta": 0.05019050091505051,
      "rmse_dx": 0.027429213747382164,
      "rmse_dy": 0.010472387075424194,
      "rmse_mean": 0.02936403453350067,
      "rotation_flip": 0.012709029950201511,
      "sparse_tokens": 26331.0,
      "step": 8870,
      "turn_loss": 0.2644102871417999,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.4121445827913027,
      "grad_norm": 0.5715808272361755,
      "learning_rate": 1.6171777051203052e-06,
      "loss": 0.1656,
      "mae_dtheta": 0.03966008126735687,
      "mae_dx": 0.015069069340825081,
      "mae_dy": 0.006394643802195787,
      "pose_mae_dtheta": 0.3195033371448517,
      "pose_mae_dx": 0.11238190531730652,
      "pose_mae_dy": 0.06309767812490463,
      "pose_rmse_dtheta": 0.57284015417099,
      "pose_rmse_dx": 0.2208670824766159,
      "pose_rmse_dy": 0.15405315160751343,
      "pose_rmse_mean": 0.3159201443195343,
      "rmse_dtheta": 0.060310885310173035,
      "rmse_dx": 0.027660226449370384,
      "rmse_dy": 0.014896608889102936,
      "rmse_mean": 0.03428924083709717,
      "rotation_flip": 0.017326733097434044,
      "sparse_tokens": 7780.0,
      "step": 8871,
      "turn_loss": 0.4615233540534973,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4121910425571455,
      "grad_norm": 0.37666618824005127,
      "learning_rate": 1.616204163175325e-06,
      "loss": 0.0697,
      "mae_dtheta": 0.009581656195223331,
      "mae_dx": 0.0014444149564951658,
      "mae_dy": 0.0019448044477030635,
      "pose_mae_dtheta": 0.06834971904754639,
      "pose_mae_dx": 0.020725717768073082,
      "pose_mae_dy": 0.02771497704088688,
      "pose_rmse_dtheta": 0.17199084162712097,
      "pose_rmse_dx": 0.06621791422367096,
      "pose_rmse_dy": 0.07188739627599716,
      "pose_rmse_mean": 0.10336538404226303,
      "rmse_dtheta": 0.021147575229406357,
      "rmse_dx": 0.00521856639534235,
      "rmse_dy": 0.0046348064206540585,
      "rmse_mean": 0.010333649814128876,
      "rotation_flip": 0.0039100684225559235,
      "sparse_tokens": 32041.0,
      "step": 8872,
      "turn_loss": 0.0710996463894844,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.4122375023229883,
      "grad_norm": 0.5730823874473572,
      "learning_rate": 1.6152308578610037e-06,
      "loss": 0.0803,
      "mae_dtheta": 0.025957858189940453,
      "mae_dx": 0.010705264285206795,
      "mae_dy": 0.006765513215214014,
      "pose_mae_dtheta": 0.20943720638751984,
      "pose_mae_dx": 0.07448878884315491,
      "pose_mae_dy": 0.07580344378948212,
      "pose_rmse_dtheta": 0.44100862741470337,
      "pose_rmse_dx": 0.1547374278306961,
      "pose_rmse_dy": 0.17348182201385498,
      "pose_rmse_mean": 0.25640928745269775,
      "rmse_dtheta": 0.04548100754618645,
      "rmse_dx": 0.021674562245607376,
      "rmse_dy": 0.012913338840007782,
      "rmse_mean": 0.026689637452363968,
      "rotation_flip": 0.00522193219512701,
      "sparse_tokens": 6551.0,
      "step": 8873,
      "turn_loss": 0.2920295298099518,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.41228396208883106,
      "grad_norm": 0.47109606862068176,
      "learning_rate": 1.614257789245407e-06,
      "loss": 0.0884,
      "mae_dtheta": 0.009375310502946377,
      "mae_dx": 0.0015988516388460994,
      "mae_dy": 0.0014806842664256692,
      "pose_mae_dtheta": 0.06493987888097763,
      "pose_mae_dx": 0.016896404325962067,
      "pose_mae_dy": 0.02012154832482338,
      "pose_rmse_dtheta": 0.2036617398262024,
      "pose_rmse_dx": 0.04325680062174797,
      "pose_rmse_dy": 0.04607083275914192,
      "pose_rmse_mean": 0.09766312688589096,
      "rmse_dtheta": 0.02305302768945694,
      "rmse_dx": 0.005371307488530874,
      "rmse_dy": 0.0030881231650710106,
      "rmse_mean": 0.010504152625799179,
      "rotation_flip": 0.0029648453928530216,
      "sparse_tokens": 32105.0,
      "step": 8874,
      "turn_loss": 0.06840816885232925,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.41233042185467383,
      "grad_norm": 0.5219689011573792,
      "learning_rate": 1.6132849573965781e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.027869991958141327,
      "mae_dx": 0.010565533302724361,
      "mae_dy": 0.00418700510635972,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5219689011573792,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.90443420410156,
      "model/head/act_norm_mean": 114.61324439858491,
      "model/head/act_norm_min": 72.95317840576172,
      "model/head/act_over_embed": 78.76329457680741,
      "model/head/grad_frac": 0.08759821206331253,
      "model/head/grad_norm": 0.04572354257106781,
      "model/head/grad_zero_frac": 0.00018782488768920302,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6910008844339622,
      "model/head/update_ratio": 0.0007786598871462047,
      "model/head/weight_delta": 9.841604232788086,
      "model/head/weight_delta_rel": 0.17265088856220245,
      "model/head/weight_norm": 58.7208137512207,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4225884974002838,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4225076746057581,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42244794964790344,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2903512295682478,
      "model/modality_embedder.encoders.pose/grad_frac": 0.2824874222278595,
      "model/modality_embedder.encoders.pose/grad_norm": 0.14744964241981506,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5292245370370371,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0047613466158509254,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1276230812072754,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10218919068574905,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968055725097656,
      "model/modality_embedder/grad_frac": 0.2824874222278595,
      "model/modality_embedder/grad_norm": 0.14744964241981506,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5292245370370371,
      "model/modality_embedder/update_ratio": 0.0047613466158509254,
      "model/modality_embedder/weight_delta": 3.1276230812072754,
      "model/modality_embedder/weight_delta_rel": 0.10218919068574905,
      "model/modality_embedder/weight_norm": 30.968055725097656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.49738311767578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.08737646001797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.301970481872559,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.55307061289573,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06231709197163582,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.032527584582567215,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011640171287581325,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6683907508850098,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09723776578903198,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.944250106811523,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.07698822021484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.89618897873615,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.543981552124023,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.108894147980966,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.061887890100479126,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03230355307459831,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001086043193936348,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3833212852478027,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11720089614391327,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.7442626953125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.76649475097656,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.540772873614856,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.581083297729492,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.239067597378618,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06134391203522682,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.032019615173339844,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010425166692584753,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6609928607940674,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12292928248643875,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.713768005371094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.42511749267578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.333747473045822,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.395685195922852,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.471216528200245,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06667798012495041,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.034803830087184906,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001162711763754487,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1413278579711914,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10735567659139633,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.933324813842773,
      "model/normalizer/grad_frac": 0.2873062789440155,
      "model/normalizer/grad_norm": 0.14996494352817535,
      "model/normalizer/grad_zero_frac": 0.0002115311799570918,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001907272613607347,
      "model/normalizer/weight_delta": 6.61875057220459,
      "model/normalizer/weight_delta_rel": 0.08524567633867264,
      "model/normalizer/weight_norm": 78.6279525756836,
      "pose_mae_dtheta": 0.20704513788223267,
      "pose_mae_dx": 0.08405306935310364,
      "pose_mae_dy": 0.036750420928001404,
      "pose_rmse_dtheta": 0.4120071232318878,
      "pose_rmse_dx": 0.22386834025382996,
      "pose_rmse_dy": 0.07416924089193344,
      "pose_rmse_mean": 0.23668156564235687,
      "rmse_dtheta": 0.04677492380142212,
      "rmse_dx": 0.023576712235808372,
      "rmse_dy": 0.01084782462567091,
      "rmse_mean": 0.027066487818956375,
      "rotation_flip": 0.011544011533260345,
      "sparse_tokens": 13847.0,
      "step": 8875,
      "turn_loss": 0.2673574984073639,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4123768816205166,
      "grad_norm": 0.48969724774360657,
      "learning_rate": 1.612312362382552e-06,
      "loss": 0.1194,
      "mae_dtheta": 0.008926298469305038,
      "mae_dx": 0.0017351649003103375,
      "mae_dy": 0.0025298651307821274,
      "pose_mae_dtheta": 0.05496272072196007,
      "pose_mae_dx": 0.02418447658419609,
      "pose_mae_dy": 0.022670691832900047,
      "pose_rmse_dtheta": 0.15809428691864014,
      "pose_rmse_dx": 0.06293145567178726,
      "pose_rmse_dy": 0.050903886556625366,
      "pose_rmse_mean": 0.09064321219921112,
      "rmse_dtheta": 0.021230578422546387,
      "rmse_dx": 0.004197755828499794,
      "rmse_dy": 0.005842745304107666,
      "rmse_mean": 0.010423692874610424,
      "rotation_flip": 0.0031043849885463715,
      "sparse_tokens": 32121.0,
      "step": 8876,
      "turn_loss": 0.08241353183984756,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4124233413863594,
      "grad_norm": 0.6542555093765259,
      "learning_rate": 1.611340004271339e-06,
      "loss": 0.1516,
      "mae_dtheta": 0.01235500443726778,
      "mae_dx": 0.0017696708673611283,
      "mae_dy": 0.0027381384279578924,
      "pose_mae_dtheta": 0.08525902032852173,
      "pose_mae_dx": 0.0217116829007864,
      "pose_mae_dy": 0.03029940277338028,
      "pose_rmse_dtheta": 0.23095569014549255,
      "pose_rmse_dx": 0.05760088935494423,
      "pose_rmse_dy": 0.06900004297494888,
      "pose_rmse_mean": 0.11918553709983826,
      "rmse_dtheta": 0.026498964056372643,
      "rmse_dx": 0.005814278498291969,
      "rmse_dy": 0.006812191102653742,
      "rmse_mean": 0.013041811995208263,
      "rotation_flip": 0.004558204673230648,
      "sparse_tokens": 32121.0,
      "step": 8877,
      "turn_loss": 0.10326677560806274,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4124698011522022,
      "grad_norm": 0.7297571897506714,
      "learning_rate": 1.61036788313094e-06,
      "loss": 0.207,
      "mae_dtheta": 0.007002537604421377,
      "mae_dx": 0.0016656325897201896,
      "mae_dy": 0.0016721865395084023,
      "pose_mae_dtheta": 0.048779163509607315,
      "pose_mae_dx": 0.017163529992103577,
      "pose_mae_dy": 0.01621491089463234,
      "pose_rmse_dtheta": 0.16981492936611176,
      "pose_rmse_dx": 0.06600666046142578,
      "pose_rmse_dy": 0.04759954661130905,
      "pose_rmse_mean": 0.0944737121462822,
      "rmse_dtheta": 0.01973138190805912,
      "rmse_dx": 0.006237630266696215,
      "rmse_dy": 0.006299033761024475,
      "rmse_mean": 0.01075601577758789,
      "rotation_flip": 0.003342884359881282,
      "sparse_tokens": 32121.0,
      "step": 8878,
      "turn_loss": 0.06562978774309158,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.412516260918045,
      "grad_norm": 0.6167985796928406,
      "learning_rate": 1.6093959990293323e-06,
      "loss": 0.0922,
      "mae_dtheta": 0.031828779727220535,
      "mae_dx": 0.007893434725701809,
      "mae_dy": 0.006824502721428871,
      "pose_mae_dtheta": 0.2647184729576111,
      "pose_mae_dx": 0.049224209040403366,
      "pose_mae_dy": 0.04862504452466965,
      "pose_rmse_dtheta": 0.4216075539588928,
      "pose_rmse_dx": 0.12709054350852966,
      "pose_rmse_dy": 0.1250232607126236,
      "pose_rmse_mean": 0.2245737761259079,
      "rmse_dtheta": 0.04977582022547722,
      "rmse_dx": 0.018068253993988037,
      "rmse_dy": 0.015078064054250717,
      "rmse_mean": 0.02764071524143219,
      "rotation_flip": 0.01812688820064068,
      "sparse_tokens": 5391.0,
      "step": 8879,
      "turn_loss": 0.29697489738464355,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.4125627206838878,
      "grad_norm": 0.35138827562332153,
      "learning_rate": 1.6084243520344827e-06,
      "loss": 0.1056,
      "mae_dtheta": 0.03192368149757385,
      "mae_dx": 0.008158047683537006,
      "mae_dy": 0.005735232960432768,
      "pose_mae_dtheta": 0.22550749778747559,
      "pose_mae_dx": 0.0727795958518982,
      "pose_mae_dy": 0.05957396328449249,
      "pose_rmse_dtheta": 0.41844290494918823,
      "pose_rmse_dx": 0.17637450993061066,
      "pose_rmse_dy": 0.14146831631660461,
      "pose_rmse_mean": 0.24542856216430664,
      "rmse_dtheta": 0.05052981153130531,
      "rmse_dx": 0.018082674592733383,
      "rmse_dy": 0.01224651001393795,
      "rmse_mean": 0.02695300057530403,
      "rotation_flip": 0.019295301288366318,
      "sparse_tokens": 19624.0,
      "step": 8880,
      "turn_loss": 0.24551650881767273,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.41260918044973055,
      "grad_norm": 0.4356279969215393,
      "learning_rate": 1.6074529422143398e-06,
      "loss": 0.0975,
      "mae_dtheta": 0.005756588652729988,
      "mae_dx": 0.0012291029561311007,
      "mae_dy": 0.001455887919291854,
      "pose_mae_dtheta": 0.04053613543510437,
      "pose_mae_dx": 0.01591799221932888,
      "pose_mae_dy": 0.013924550265073776,
      "pose_rmse_dtheta": 0.1678311824798584,
      "pose_rmse_dx": 0.04592014476656914,
      "pose_rmse_dy": 0.036390554159879684,
      "pose_rmse_mean": 0.08338063210248947,
      "rmse_dtheta": 0.01903580315411091,
      "rmse_dx": 0.003517154138535261,
      "rmse_dy": 0.0042497445829212666,
      "rmse_mean": 0.008934234268963337,
      "rotation_flip": 0.002475247485563159,
      "sparse_tokens": 32073.0,
      "step": 8881,
      "turn_loss": 0.03994471952319145,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.4126556402155733,
      "grad_norm": 0.5720915198326111,
      "learning_rate": 1.6064817696368324e-06,
      "loss": 0.1357,
      "mae_dtheta": 0.028062177821993828,
      "mae_dx": 0.008194350637495518,
      "mae_dy": 0.006216860841959715,
      "pose_mae_dtheta": 0.2121119201183319,
      "pose_mae_dx": 0.07273899018764496,
      "pose_mae_dy": 0.08270582556724548,
      "pose_rmse_dtheta": 0.42315226793289185,
      "pose_rmse_dx": 0.1725849211215973,
      "pose_rmse_dy": 0.21254080533981323,
      "pose_rmse_mean": 0.26942601799964905,
      "rmse_dtheta": 0.04530412703752518,
      "rmse_dx": 0.019681746140122414,
      "rmse_dy": 0.014151645824313164,
      "rmse_mean": 0.0263791736215353,
      "rotation_flip": 0.0060240961611270905,
      "sparse_tokens": 13208.0,
      "step": 8882,
      "turn_loss": 0.22256827354431152,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4127020999814161,
      "grad_norm": 0.43195873498916626,
      "learning_rate": 1.6055108343698773e-06,
      "loss": 0.0815,
      "mae_dtheta": 0.006623577792197466,
      "mae_dx": 0.0008627778734080493,
      "mae_dy": 0.0013800034066662192,
      "pose_mae_dtheta": 0.04032699391245842,
      "pose_mae_dx": 0.013297946192324162,
      "pose_mae_dy": 0.01809486746788025,
      "pose_rmse_dtheta": 0.08444838970899582,
      "pose_rmse_dx": 0.03532490134239197,
      "pose_rmse_dy": 0.044572122395038605,
      "pose_rmse_mean": 0.05478180572390556,
      "rmse_dtheta": 0.014927013777196407,
      "rmse_dx": 0.00238486984744668,
      "rmse_dy": 0.0032350944820791483,
      "rmse_mean": 0.00684899277985096,
      "rotation_flip": 0.003035559318959713,
      "sparse_tokens": 32105.0,
      "step": 8883,
      "turn_loss": 0.04986250400543213,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.4127485597472589,
      "grad_norm": 0.644097089767456,
      "learning_rate": 1.60454013648137e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.0312543623149395,
      "mae_dx": 0.01681544817984104,
      "mae_dy": 0.002956114709377289,
      "pose_mae_dtheta": 0.2755759358406067,
      "pose_mae_dx": 0.13416482508182526,
      "pose_mae_dy": 0.03520694747567177,
      "pose_rmse_dtheta": 0.49118828773498535,
      "pose_rmse_dx": 0.30218014121055603,
      "pose_rmse_dy": 0.11350595206022263,
      "pose_rmse_mean": 0.30229148268699646,
      "rmse_dtheta": 0.049366891384124756,
      "rmse_dx": 0.03141791373491287,
      "rmse_dy": 0.006922613829374313,
      "rmse_mean": 0.029235806316137314,
      "rotation_flip": 0.014705882407724857,
      "sparse_tokens": 7233.0,
      "step": 8884,
      "turn_loss": 0.17274971306324005,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.41279501951310166,
      "grad_norm": 0.49356967210769653,
      "learning_rate": 1.6035696760391934e-06,
      "loss": 0.0652,
      "mae_dtheta": 0.006676151417195797,
      "mae_dx": 0.0025150247383862734,
      "mae_dy": 0.0013349589426070452,
      "pose_mae_dtheta": 0.046215008944272995,
      "pose_mae_dx": 0.026159634813666344,
      "pose_mae_dy": 0.016569415107369423,
      "pose_rmse_dtheta": 0.15265657007694244,
      "pose_rmse_dx": 0.10010572522878647,
      "pose_rmse_dy": 0.038870882242918015,
      "pose_rmse_mean": 0.09721105545759201,
      "rmse_dtheta": 0.018405679613351822,
      "rmse_dx": 0.009860186837613583,
      "rmse_dy": 0.003160248976200819,
      "rmse_mean": 0.010475372895598412,
      "rotation_flip": 0.0031308704055845737,
      "sparse_tokens": 32041.0,
      "step": 8885,
      "turn_loss": 0.05858176574110985,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32986.0,
      "epoch": 0.41284147927894443,
      "grad_norm": 0.571702778339386,
      "learning_rate": 1.6025994531112143e-06,
      "loss": 0.1802,
      "mae_dtheta": 0.035916320979595184,
      "mae_dx": 0.01368720643222332,
      "mae_dy": 0.005688136909157038,
      "pose_mae_dtheta": 0.29036766290664673,
      "pose_mae_dx": 0.108737513422966,
      "pose_mae_dy": 0.06974302232265472,
      "pose_rmse_dtheta": 0.505780041217804,
      "pose_rmse_dx": 0.23862384259700775,
      "pose_rmse_dy": 0.16675034165382385,
      "pose_rmse_mean": 0.30371809005737305,
      "rmse_dtheta": 0.054486922919750214,
      "rmse_dx": 0.02678493782877922,
      "rmse_dy": 0.012407874688506126,
      "rmse_mean": 0.03122657909989357,
      "rotation_flip": 0.012624585069715977,
      "sparse_tokens": 27312.0,
      "step": 8886,
      "turn_loss": 0.28075873851776123,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4128879390447872,
      "grad_norm": 0.34584856033325195,
      "learning_rate": 1.6016294677652772e-06,
      "loss": 0.075,
      "mae_dtheta": 0.00809191633015871,
      "mae_dx": 0.0015111059183254838,
      "mae_dy": 0.0012126185465604067,
      "pose_mae_dtheta": 0.054889362305402756,
      "pose_mae_dx": 0.014257236383855343,
      "pose_mae_dy": 0.015011628158390522,
      "pose_rmse_dtheta": 0.15155522525310516,
      "pose_rmse_dx": 0.03906172141432762,
      "pose_rmse_dy": 0.03953069821000099,
      "pose_rmse_mean": 0.07671588659286499,
      "rmse_dtheta": 0.02154708094894886,
      "rmse_dx": 0.004173350054770708,
      "rmse_dy": 0.0028800007421523333,
      "rmse_mean": 0.009533477947115898,
      "rotation_flip": 0.00357001181691885,
      "sparse_tokens": 32201.0,
      "step": 8887,
      "turn_loss": 0.06087544932961464,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.41293439881063,
      "grad_norm": 0.396241158246994,
      "learning_rate": 1.600659720069217e-06,
      "loss": 0.0815,
      "mae_dtheta": 0.006563617382198572,
      "mae_dx": 0.002107609063386917,
      "mae_dy": 0.001890198909677565,
      "pose_mae_dtheta": 0.049864862114191055,
      "pose_mae_dx": 0.020433086901903152,
      "pose_mae_dy": 0.014220247976481915,
      "pose_rmse_dtheta": 0.15468505024909973,
      "pose_rmse_dx": 0.06593871861696243,
      "pose_rmse_dy": 0.04560720548033714,
      "pose_rmse_mean": 0.088743656873703,
      "rmse_dtheta": 0.01959061808884144,
      "rmse_dx": 0.005475148092955351,
      "rmse_dy": 0.0066367550753057,
      "rmse_mean": 0.010567507706582546,
      "rotation_flip": 0.004285714123398066,
      "sparse_tokens": 32201.0,
      "step": 8888,
      "turn_loss": 0.055115144699811935,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.41298085857647276,
      "grad_norm": 0.36232396960258484,
      "learning_rate": 1.599690210090845e-06,
      "loss": 0.059,
      "mae_dtheta": 0.006165934260934591,
      "mae_dx": 0.001262812758795917,
      "mae_dy": 0.001515039475634694,
      "pose_mae_dtheta": 0.03775349631905556,
      "pose_mae_dx": 0.012818942777812481,
      "pose_mae_dy": 0.015357615426182747,
      "pose_rmse_dtheta": 0.13222165405750275,
      "pose_rmse_dx": 0.02927236445248127,
      "pose_rmse_dy": 0.034067850559949875,
      "pose_rmse_mean": 0.06518729031085968,
      "rmse_dtheta": 0.017400436103343964,
      "rmse_dx": 0.003729642368853092,
      "rmse_dy": 0.0032939715310931206,
      "rmse_mean": 0.008141350001096725,
      "rotation_flip": 0.003246753243729472,
      "sparse_tokens": 32073.0,
      "step": 8889,
      "turn_loss": 0.059123445302248,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 62864.0,
      "epoch": 0.41302731834231554,
      "grad_norm": 0.7271283864974976,
      "learning_rate": 1.598720937897964e-06,
      "loss": 0.1019,
      "mae_dtheta": 0.008360694162547588,
      "mae_dx": 0.0009925373597070575,
      "mae_dy": 0.00205621519125998,
      "pose_mae_dtheta": 0.049447838217020035,
      "pose_mae_dx": 0.014767756685614586,
      "pose_mae_dy": 0.024157444015145302,
      "pose_rmse_dtheta": 0.0958452895283699,
      "pose_rmse_dx": 0.03244337439537048,
      "pose_rmse_dy": 0.05529037490487099,
      "pose_rmse_mean": 0.061193011701107025,
      "rmse_dtheta": 0.01623334363102913,
      "rmse_dx": 0.002807454438880086,
      "rmse_dy": 0.004357566591352224,
      "rmse_mean": 0.007799455430358648,
      "rotation_flip": 0.0031397175043821335,
      "sparse_tokens": 31964.0,
      "step": 8890,
      "turn_loss": 0.07099700719118118,
      "turns": 193.0,
      "turns_per_sample": 193.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.4130737781081583,
      "grad_norm": 0.5173159241676331,
      "learning_rate": 1.5977519035583517e-06,
      "loss": 0.121,
      "mae_dtheta": 0.027447395026683807,
      "mae_dx": 0.005079620983451605,
      "mae_dy": 0.0056962077505886555,
      "pose_mae_dtheta": 0.22996720671653748,
      "pose_mae_dx": 0.05103373900055885,
      "pose_mae_dy": 0.08349845558404922,
      "pose_rmse_dtheta": 0.48799246549606323,
      "pose_rmse_dx": 0.14794936776161194,
      "pose_rmse_dy": 0.20085857808589935,
      "pose_rmse_mean": 0.27893349528312683,
      "rmse_dtheta": 0.04756099358201027,
      "rmse_dx": 0.012485524639487267,
      "rmse_dy": 0.012603482231497765,
      "rmse_mean": 0.0242166668176651,
      "rotation_flip": 0.0044247787445783615,
      "sparse_tokens": 5227.0,
      "step": 8891,
      "turn_loss": 0.2919095456600189,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 6845.0,
      "epoch": 0.4131202378740011,
      "grad_norm": 0.5748067498207092,
      "learning_rate": 1.5967831071397743e-06,
      "loss": 0.1336,
      "mae_dtheta": 0.036489956080913544,
      "mae_dx": 0.0092506418004632,
      "mae_dy": 0.005650877952575684,
      "pose_mae_dtheta": 0.3224700093269348,
      "pose_mae_dx": 0.07628030329942703,
      "pose_mae_dy": 0.05352742224931717,
      "pose_rmse_dtheta": 0.5529173016548157,
      "pose_rmse_dx": 0.16469383239746094,
      "pose_rmse_dy": 0.16199494898319244,
      "pose_rmse_mean": 0.2932020425796509,
      "rmse_dtheta": 0.058176908642053604,
      "rmse_dx": 0.019733520224690437,
      "rmse_dy": 0.013449961319565773,
      "rmse_mean": 0.03045346401631832,
      "rotation_flip": 0.005633802618831396,
      "sparse_tokens": 5647.0,
      "step": 8892,
      "turn_loss": 0.2935929596424103,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 39790.0,
      "epoch": 0.41316669763984387,
      "grad_norm": 0.49217280745506287,
      "learning_rate": 1.5958145487099829e-06,
      "loss": 0.1198,
      "mae_dtheta": 0.03441257402300835,
      "mae_dx": 0.010230098851025105,
      "mae_dy": 0.005933431908488274,
      "pose_mae_dtheta": 0.26407143473625183,
      "pose_mae_dx": 0.09105648845434189,
      "pose_mae_dy": 0.061421070247888565,
      "pose_rmse_dtheta": 0.48612022399902344,
      "pose_rmse_dx": 0.20256493985652924,
      "pose_rmse_dy": 0.14654360711574554,
      "pose_rmse_mean": 0.27840960025787354,
      "rmse_dtheta": 0.05288168787956238,
      "rmse_dx": 0.021191289648413658,
      "rmse_dy": 0.013746964745223522,
      "rmse_mean": 0.029273314401507378,
      "rotation_flip": 0.01185536477714777,
      "sparse_tokens": 29890.0,
      "step": 8893,
      "turn_loss": 0.2733868658542633,
      "turns": 123.0,
      "turns_per_sample": 123.0
    },
    {
      "dense_tokens": 27496.0,
      "epoch": 0.41321315740568665,
      "grad_norm": 0.44038358330726624,
      "learning_rate": 1.5948462283367055e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.026646209880709648,
      "mae_dx": 0.007797313388437033,
      "mae_dy": 0.003977814689278603,
      "pose_mae_dtheta": 0.21311603486537933,
      "pose_mae_dx": 0.062691830098629,
      "pose_mae_dy": 0.03868177905678749,
      "pose_rmse_dtheta": 0.40167734026908875,
      "pose_rmse_dx": 0.1338811069726944,
      "pose_rmse_dy": 0.09260228276252747,
      "pose_rmse_mean": 0.2093869149684906,
      "rmse_dtheta": 0.044585444033145905,
      "rmse_dx": 0.017170915380120277,
      "rmse_dy": 0.008784886449575424,
      "rmse_mean": 0.02351374924182892,
      "rotation_flip": 0.012552301399409771,
      "sparse_tokens": 21476.0,
      "step": 8894,
      "turn_loss": 0.20931795239448547,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.4132596171715295,
      "grad_norm": 0.5690183639526367,
      "learning_rate": 1.5938781460876612e-06,
      "loss": 0.1397,
      "mae_dtheta": 0.02236025407910347,
      "mae_dx": 0.0050809793174266815,
      "mae_dy": 0.0025376444682478905,
      "pose_mae_dtheta": 0.1701287180185318,
      "pose_mae_dx": 0.04278458282351494,
      "pose_mae_dy": 0.05008089542388916,
      "pose_rmse_dtheta": 0.3728443384170532,
      "pose_rmse_dx": 0.13085615634918213,
      "pose_rmse_dy": 0.11038941144943237,
      "pose_rmse_mean": 0.2046966403722763,
      "rmse_dtheta": 0.04217802733182907,
      "rmse_dx": 0.01611982472240925,
      "rmse_dy": 0.005138826556503773,
      "rmse_mean": 0.02114555984735489,
      "rotation_flip": 0.014760147780179977,
      "sparse_tokens": 5023.0,
      "step": 8895,
      "turn_loss": 0.10356724262237549,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.41330607693737226,
      "grad_norm": 0.4723747670650482,
      "learning_rate": 1.5929103020305441e-06,
      "loss": 0.0969,
      "mae_dtheta": 0.031244957819581032,
      "mae_dx": 0.028335843235254288,
      "mae_dy": 0.012882065027952194,
      "pose_mae_dtheta": 0.2733221650123596,
      "pose_mae_dx": 0.20771555602550507,
      "pose_mae_dy": 0.187765434384346,
      "pose_rmse_dtheta": 0.4244455397129059,
      "pose_rmse_dx": 0.37696343660354614,
      "pose_rmse_dy": 0.31204286217689514,
      "pose_rmse_mean": 0.3711506128311157,
      "rmse_dtheta": 0.048254769295454025,
      "rmse_dx": 0.04301019012928009,
      "rmse_dy": 0.0182640478014946,
      "rmse_mean": 0.036509670317173004,
      "rotation_flip": 0.02857142873108387,
      "sparse_tokens": 3287.0,
      "step": 8896,
      "turn_loss": 0.3858482837677002,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.41335253670321503,
      "grad_norm": 0.4154494106769562,
      "learning_rate": 1.5919426962330398e-06,
      "loss": 0.0845,
      "mae_dtheta": 0.005602586083114147,
      "mae_dx": 0.0011778955813497305,
      "mae_dy": 0.000826040341053158,
      "pose_mae_dtheta": 0.0390312597155571,
      "pose_mae_dx": 0.011559191159904003,
      "pose_mae_dy": 0.011990790255367756,
      "pose_rmse_dtheta": 0.1321469247341156,
      "pose_rmse_dx": 0.0281378086656332,
      "pose_rmse_dy": 0.03146211802959442,
      "pose_rmse_mean": 0.06391561776399612,
      "rmse_dtheta": 0.017350073903799057,
      "rmse_dx": 0.0036087387707084417,
      "rmse_dy": 0.0020455277990549803,
      "rmse_mean": 0.007668113335967064,
      "rotation_flip": 0.0030581040773540735,
      "sparse_tokens": 32185.0,
      "step": 8897,
      "turn_loss": 0.038137566298246384,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.4133989964690578,
      "grad_norm": 0.7448951601982117,
      "learning_rate": 1.5909753287628105e-06,
      "loss": 0.1382,
      "mae_dtheta": 0.03151266649365425,
      "mae_dx": 0.014292595908045769,
      "mae_dy": 0.00447345245629549,
      "pose_mae_dtheta": 0.23972837626934052,
      "pose_mae_dx": 0.1297137290239334,
      "pose_mae_dy": 0.052583370357751846,
      "pose_rmse_dtheta": 0.46153372526168823,
      "pose_rmse_dx": 0.2736014127731323,
      "pose_rmse_dy": 0.1250733733177185,
      "pose_rmse_mean": 0.2867361903190613,
      "rmse_dtheta": 0.049701180309057236,
      "rmse_dx": 0.02734723873436451,
      "rmse_dy": 0.011173374950885773,
      "rmse_mean": 0.029407266527414322,
      "rotation_flip": 0.012061403132975101,
      "sparse_tokens": 17516.0,
      "step": 8898,
      "turn_loss": 0.2535523474216461,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4134454562349006,
      "grad_norm": 0.3807874023914337,
      "learning_rate": 1.5900081996875083e-06,
      "loss": 0.0766,
      "mae_dtheta": 0.007314241025596857,
      "mae_dx": 0.0012342174304649234,
      "mae_dy": 0.0015094948466867208,
      "pose_mae_dtheta": 0.04216791316866875,
      "pose_mae_dx": 0.012411178089678288,
      "pose_mae_dy": 0.021648600697517395,
      "pose_rmse_dtheta": 0.08489464968442917,
      "pose_rmse_dx": 0.028925232589244843,
      "pose_rmse_dy": 0.054010238498449326,
      "pose_rmse_mean": 0.05594337731599808,
      "rmse_dtheta": 0.015034649521112442,
      "rmse_dx": 0.004010085482150316,
      "rmse_dy": 0.003777814097702503,
      "rmse_mean": 0.007607515901327133,
      "rotation_flip": 0.007910074666142464,
      "sparse_tokens": 32121.0,
      "step": 8899,
      "turn_loss": 0.06107746437191963,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.41349191600074336,
      "grad_norm": 0.387124240398407,
      "learning_rate": 1.5890413090747625e-06,
      "loss": 0.0952,
      "mae_dtheta": 0.009374252520501614,
      "mae_dx": 0.0020397109910845757,
      "mae_dy": 0.0029608311597257853,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.38712432980537415,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.75537109375,
      "model/head/act_norm_mean": 109.22671046401516,
      "model/head/act_norm_min": 49.42671585083008,
      "model/head/act_over_embed": 75.06161802744585,
      "model/head/grad_frac": 0.11888108402490616,
      "model/head/grad_norm": 0.04602175951004028,
      "model/head/grad_zero_frac": 0.00015419407282024622,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7040177162247475,
      "model/head/update_ratio": 0.0007837298326194286,
      "model/head/weight_delta": 9.844871520996094,
      "model/head/weight_delta_rel": 0.17270821332931519,
      "model/head/weight_norm": 58.721458435058594,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42260417342185974,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42252397751059767,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4224376976490021,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29036243307708376,
      "model/modality_embedder.encoders.pose/grad_frac": 0.106127068400383,
      "model/modality_embedder.encoders.pose/grad_norm": 0.041084371507167816,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5480398682735426,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013266634196043015,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1274709701538086,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1021842211484909,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96819496154785,
      "model/modality_embedder/grad_frac": 0.106127068400383,
      "model/modality_embedder/grad_norm": 0.041084371507167816,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5480398682735426,
      "model/modality_embedder/update_ratio": 0.0013266634196043015,
      "model/modality_embedder/weight_delta": 3.1274709701538086,
      "model/modality_embedder/weight_delta_rel": 0.1021842211484909,
      "model/modality_embedder/weight_norm": 30.96819496154785,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.94762420654297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.602911556036556,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.011430740356445,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.22014179524781,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0740174800157547,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.028653966262936592,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010253883665427566,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6700305938720703,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09729752689599991,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.944501876831055,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.84321594238281,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.604422198172198,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.31453800201416,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.90838928481378,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07399960607290268,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02864704839885235,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009630958666093647,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.385249614715576,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11726769059896469,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.744752883911133,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.69759368896484,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.43448623136123,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.612762451171875,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.166026421750704,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08401977270841599,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03252609819173813,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010589800076559186,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6634182929992676,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12301072478294373,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.71455192565918,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.16764831542969,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.198708313291647,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.589408874511719,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.378416353360645,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08296703547239304,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03211855888366699,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010729852365329862,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.14351487159729,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10743042081594467,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9338321685791,
      "model/normalizer/grad_frac": 0.3249259293079376,
      "model/normalizer/grad_norm": 0.12578673660755157,
      "model/normalizer/grad_zero_frac": 0.00020562247664202005,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001599757932126522,
      "model/normalizer/weight_delta": 6.6229705810546875,
      "model/normalizer/weight_delta_rel": 0.0853000283241272,
      "model/normalizer/weight_norm": 78.62860870361328,
      "pose_mae_dtheta": 0.06595877557992935,
      "pose_mae_dx": 0.025669319555163383,
      "pose_mae_dy": 0.02728401869535446,
      "pose_rmse_dtheta": 0.17150390148162842,
      "pose_rmse_dx": 0.09185424447059631,
      "pose_rmse_dy": 0.07651769369840622,
      "pose_rmse_mean": 0.11329194903373718,
      "rmse_dtheta": 0.02224229834973812,
      "rmse_dx": 0.008234110660851002,
      "rmse_dy": 0.008263785392045975,
      "rmse_mean": 0.012913398444652557,
      "rotation_flip": 0.004702194128185511,
      "sparse_tokens": 32105.0,
      "step": 8900,
      "turn_loss": 0.08469264954328537,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.41353837576658614,
      "grad_norm": 0.5160173773765564,
      "learning_rate": 1.5880746569921867e-06,
      "loss": 0.0933,
      "mae_dtheta": 0.030458299443125725,
      "mae_dx": 0.01009247824549675,
      "mae_dy": 0.0033188634552061558,
      "pose_mae_dtheta": 0.23153603076934814,
      "pose_mae_dx": 0.07234765589237213,
      "pose_mae_dy": 0.037888385355472565,
      "pose_rmse_dtheta": 0.43302279710769653,
      "pose_rmse_dx": 0.1911948025226593,
      "pose_rmse_dy": 0.08793612569570541,
      "pose_rmse_mean": 0.2373845875263214,
      "rmse_dtheta": 0.04815877601504326,
      "rmse_dx": 0.022445591166615486,
      "rmse_dy": 0.005950453691184521,
      "rmse_mean": 0.025518273934721947,
      "rotation_flip": 0.012544803321361542,
      "sparse_tokens": 10047.0,
      "step": 8901,
      "turn_loss": 0.19602389633655548,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.4135848355324289,
      "grad_norm": 0.9160760641098022,
      "learning_rate": 1.5871082435073837e-06,
      "loss": 0.229,
      "mae_dtheta": 0.045766666531562805,
      "mae_dx": 0.008059622719883919,
      "mae_dy": 0.007996393367648125,
      "pose_mae_dtheta": 0.34037137031555176,
      "pose_mae_dx": 0.09330573678016663,
      "pose_mae_dy": 0.0945618599653244,
      "pose_rmse_dtheta": 0.5354738831520081,
      "pose_rmse_dx": 0.19653619825839996,
      "pose_rmse_dy": 0.18410345911979675,
      "pose_rmse_mean": 0.30537116527557373,
      "rmse_dtheta": 0.06175457686185837,
      "rmse_dx": 0.018769510090351105,
      "rmse_dy": 0.01348053477704525,
      "rmse_mean": 0.031334877014160156,
      "rotation_flip": 0.02254098281264305,
      "sparse_tokens": 8284.0,
      "step": 8902,
      "turn_loss": 0.2739982604980469,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.4136312952982717,
      "grad_norm": 1.7384591102600098,
      "learning_rate": 1.5861420686879314e-06,
      "loss": 0.235,
      "mae_dtheta": 0.02420029416680336,
      "mae_dx": 0.0072045293636620045,
      "mae_dy": 0.0038736502174288034,
      "pose_mae_dtheta": 0.17480312287807465,
      "pose_mae_dx": 0.05408284813165665,
      "pose_mae_dy": 0.044564131647348404,
      "pose_rmse_dtheta": 0.32742658257484436,
      "pose_rmse_dx": 0.12209893763065338,
      "pose_rmse_dy": 0.09979820996522903,
      "pose_rmse_mean": 0.1831079125404358,
      "rmse_dtheta": 0.04043656587600708,
      "rmse_dx": 0.017760196700692177,
      "rmse_dy": 0.0075041004456579685,
      "rmse_mean": 0.02190028689801693,
      "rotation_flip": 0.013432836160063744,
      "sparse_tokens": 12673.0,
      "step": 8903,
      "turn_loss": 0.1915225386619568,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 33414.0,
      "epoch": 0.41367775506411447,
      "grad_norm": 0.5813311338424683,
      "learning_rate": 1.5851761326013965e-06,
      "loss": 0.1333,
      "mae_dtheta": 0.028283661231398582,
      "mae_dx": 0.006687707733362913,
      "mae_dy": 0.003220523474738002,
      "pose_mae_dtheta": 0.21181266009807587,
      "pose_mae_dx": 0.048066966235637665,
      "pose_mae_dy": 0.03876744583249092,
      "pose_rmse_dtheta": 0.4066566824913025,
      "pose_rmse_dx": 0.11815457046031952,
      "pose_rmse_dy": 0.09127436578273773,
      "pose_rmse_mean": 0.20536188781261444,
      "rmse_dtheta": 0.04600387066602707,
      "rmse_dx": 0.01563422381877899,
      "rmse_dy": 0.006299902684986591,
      "rmse_mean": 0.022646000608801842,
      "rotation_flip": 0.012978585436940193,
      "sparse_tokens": 26248.0,
      "step": 8904,
      "turn_loss": 0.19268980622291565,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 29109.0,
      "epoch": 0.41372421482995725,
      "grad_norm": 0.5607979893684387,
      "learning_rate": 1.5842104353153286e-06,
      "loss": 0.1463,
      "mae_dtheta": 0.039302095770835876,
      "mae_dx": 0.011159086599946022,
      "mae_dy": 0.006573226302862167,
      "pose_mae_dtheta": 0.32573845982551575,
      "pose_mae_dx": 0.09882950782775879,
      "pose_mae_dy": 0.06839704513549805,
      "pose_rmse_dtheta": 0.5586581230163574,
      "pose_rmse_dx": 0.2225114107131958,
      "pose_rmse_dy": 0.16627371311187744,
      "pose_rmse_mean": 0.31581443548202515,
      "rmse_dtheta": 0.05746302008628845,
      "rmse_dx": 0.02288644388318062,
      "rmse_dy": 0.014243143610656261,
      "rmse_mean": 0.031530868262052536,
      "rotation_flip": 0.007009345572441816,
      "sparse_tokens": 22136.0,
      "step": 8905,
      "turn_loss": 0.3158015012741089,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4137706745958,
      "grad_norm": 0.6215501427650452,
      "learning_rate": 1.5832449768972574e-06,
      "loss": 0.0825,
      "mae_dtheta": 0.008580015040934086,
      "mae_dx": 0.0012508705258369446,
      "mae_dy": 0.0016487676184624434,
      "pose_mae_dtheta": 0.05464593321084976,
      "pose_mae_dx": 0.013004430569708347,
      "pose_mae_dy": 0.02128675766289234,
      "pose_rmse_dtheta": 0.15096372365951538,
      "pose_rmse_dx": 0.03388354554772377,
      "pose_rmse_dy": 0.05347853899002075,
      "pose_rmse_mean": 0.07944193482398987,
      "rmse_dtheta": 0.020499564707279205,
      "rmse_dx": 0.004058133345097303,
      "rmse_dy": 0.004194382578134537,
      "rmse_mean": 0.009584027342498302,
      "rotation_flip": 0.0045967404730618,
      "sparse_tokens": 32105.0,
      "step": 8906,
      "turn_loss": 0.06619878113269806,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4138171343616428,
      "grad_norm": 0.7061462998390198,
      "learning_rate": 1.5822797574147004e-06,
      "loss": 0.0933,
      "mae_dtheta": 0.006997937802225351,
      "mae_dx": 0.00100037083029747,
      "mae_dy": 0.001254017697647214,
      "pose_mae_dtheta": 0.05298400670289993,
      "pose_mae_dx": 0.012094320729374886,
      "pose_mae_dy": 0.016748318448662758,
      "pose_rmse_dtheta": 0.19030560553073883,
      "pose_rmse_dx": 0.03360888361930847,
      "pose_rmse_dy": 0.04346786066889763,
      "pose_rmse_mean": 0.08912745118141174,
      "rmse_dtheta": 0.020542282611131668,
      "rmse_dx": 0.002976150717586279,
      "rmse_dy": 0.0030301744118332863,
      "rmse_mean": 0.008849537000060081,
      "rotation_flip": 0.003086419776082039,
      "sparse_tokens": 32089.0,
      "step": 8907,
      "turn_loss": 0.04780666157603264,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4138635941274856,
      "grad_norm": 0.3712593913078308,
      "learning_rate": 1.5813147769351521e-06,
      "loss": 0.0862,
      "mae_dtheta": 0.012180193327367306,
      "mae_dx": 0.002181755844503641,
      "mae_dy": 0.003750511212274432,
      "pose_mae_dtheta": 0.0859743058681488,
      "pose_mae_dx": 0.03078353963792324,
      "pose_mae_dy": 0.03883632272481918,
      "pose_rmse_dtheta": 0.18761664628982544,
      "pose_rmse_dx": 0.07972139120101929,
      "pose_rmse_dy": 0.09072203934192657,
      "pose_rmse_mean": 0.11935335397720337,
      "rmse_dtheta": 0.024800419807434082,
      "rmse_dx": 0.00641030864790082,
      "rmse_dy": 0.008214789442718029,
      "rmse_mean": 0.013141839765012264,
      "rotation_flip": 0.006045949179679155,
      "sparse_tokens": 32041.0,
      "step": 8908,
      "turn_loss": 0.12290196120738983,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.41391005389332836,
      "grad_norm": 0.5491924285888672,
      "learning_rate": 1.5803500355260986e-06,
      "loss": 0.1348,
      "mae_dtheta": 0.005797501653432846,
      "mae_dx": 0.0008646809146739542,
      "mae_dy": 0.0012831647181883454,
      "pose_mae_dtheta": 0.03759610652923584,
      "pose_mae_dx": 0.011245657689869404,
      "pose_mae_dy": 0.018928367644548416,
      "pose_rmse_dtheta": 0.08169098198413849,
      "pose_rmse_dx": 0.03338661044836044,
      "pose_rmse_dy": 0.049154963344335556,
      "pose_rmse_mean": 0.054744184017181396,
      "rmse_dtheta": 0.01256269309669733,
      "rmse_dx": 0.002693379996344447,
      "rmse_dy": 0.0030715297907590866,
      "rmse_mean": 0.0061092013493180275,
      "rotation_flip": 0.003368623787537217,
      "sparse_tokens": 32073.0,
      "step": 8909,
      "turn_loss": 0.0478435754776001,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.41395651365917113,
      "grad_norm": 0.42201104760169983,
      "learning_rate": 1.5793855332550012e-06,
      "loss": 0.0885,
      "mae_dtheta": 0.0058995517902076244,
      "mae_dx": 0.000784176227170974,
      "mae_dy": 0.0011416301131248474,
      "pose_mae_dtheta": 0.03940041363239288,
      "pose_mae_dx": 0.010459288954734802,
      "pose_mae_dy": 0.0162320788949728,
      "pose_rmse_dtheta": 0.08606944978237152,
      "pose_rmse_dx": 0.030791116878390312,
      "pose_rmse_dy": 0.04225628823041916,
      "pose_rmse_mean": 0.053038954734802246,
      "rmse_dtheta": 0.013936879113316536,
      "rmse_dx": 0.0026887699496001005,
      "rmse_dy": 0.002483679447323084,
      "rmse_mean": 0.006369776092469692,
      "rotation_flip": 0.0010695187374949455,
      "sparse_tokens": 32057.0,
      "step": 8910,
      "turn_loss": 0.050813592970371246,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.41400297342501396,
      "grad_norm": 1.1554642915725708,
      "learning_rate": 1.5784212701893088e-06,
      "loss": 0.253,
      "mae_dtheta": 0.033015958964824677,
      "mae_dx": 0.009617851115763187,
      "mae_dy": 0.004481653682887554,
      "pose_mae_dtheta": 0.27766498923301697,
      "pose_mae_dx": 0.07900772988796234,
      "pose_mae_dy": 0.038126491010189056,
      "pose_rmse_dtheta": 0.464926153421402,
      "pose_rmse_dx": 0.1429465413093567,
      "pose_rmse_dy": 0.08536721020936966,
      "pose_rmse_mean": 0.23107998073101044,
      "rmse_dtheta": 0.049077000468969345,
      "rmse_dx": 0.018408428877592087,
      "rmse_dy": 0.008395792916417122,
      "rmse_mean": 0.0252937413752079,
      "rotation_flip": 0.015267175622284412,
      "sparse_tokens": 10063.0,
      "step": 8911,
      "turn_loss": 0.2574392557144165,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.41404943319085674,
      "grad_norm": 0.757770836353302,
      "learning_rate": 1.5774572463964555e-06,
      "loss": 0.2202,
      "mae_dtheta": 0.03680049255490303,
      "mae_dx": 0.014877005480229855,
      "mae_dy": 0.0111293476074934,
      "pose_mae_dtheta": 0.2751278579235077,
      "pose_mae_dx": 0.12482325732707977,
      "pose_mae_dy": 0.12107902020215988,
      "pose_rmse_dtheta": 0.48024481534957886,
      "pose_rmse_dx": 0.2742116451263428,
      "pose_rmse_dy": 0.256020188331604,
      "pose_rmse_mean": 0.33682554960250854,
      "rmse_dtheta": 0.05316801369190216,
      "rmse_dx": 0.02740604802966118,
      "rmse_dy": 0.021401962265372276,
      "rmse_mean": 0.03399201110005379,
      "rotation_flip": 0.011722272261977196,
      "sparse_tokens": 18309.0,
      "step": 8912,
      "turn_loss": 0.3504614233970642,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4140958929566995,
      "grad_norm": 0.6667551398277283,
      "learning_rate": 1.5764934619438515e-06,
      "loss": 0.1255,
      "mae_dtheta": 0.009936039336025715,
      "mae_dx": 0.001388945267535746,
      "mae_dy": 0.002411437453702092,
      "pose_mae_dtheta": 0.06331240385770798,
      "pose_mae_dx": 0.020317593589425087,
      "pose_mae_dy": 0.028505347669124603,
      "pose_rmse_dtheta": 0.1813233643770218,
      "pose_rmse_dx": 0.04868492856621742,
      "pose_rmse_dy": 0.06491431593894958,
      "pose_rmse_mean": 0.0983075350522995,
      "rmse_dtheta": 0.022972941398620605,
      "rmse_dx": 0.0042673577554523945,
      "rmse_dy": 0.005057939328253269,
      "rmse_mean": 0.010766079649329185,
      "rotation_flip": 0.0028409091755747795,
      "sparse_tokens": 32073.0,
      "step": 8913,
      "turn_loss": 0.08045411109924316,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4141423527225423,
      "grad_norm": 0.33001601696014404,
      "learning_rate": 1.5755299168988996e-06,
      "loss": 0.0796,
      "mae_dtheta": 0.005413515958935022,
      "mae_dx": 0.0009455865947529674,
      "mae_dy": 0.0007805225322954357,
      "pose_mae_dtheta": 0.036863744258880615,
      "pose_mae_dx": 0.0091902706772089,
      "pose_mae_dy": 0.010663620196282864,
      "pose_rmse_dtheta": 0.12500709295272827,
      "pose_rmse_dx": 0.023763291537761688,
      "pose_rmse_dy": 0.028218969702720642,
      "pose_rmse_mean": 0.05899645388126373,
      "rmse_dtheta": 0.016747234389185905,
      "rmse_dx": 0.003087930381298065,
      "rmse_dy": 0.002025316935032606,
      "rmse_mean": 0.0072868275456130505,
      "rotation_flip": 0.001166180707514286,
      "sparse_tokens": 32089.0,
      "step": 8914,
      "turn_loss": 0.04201784357428551,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.41418881248838507,
      "grad_norm": 0.4849037528038025,
      "learning_rate": 1.574566611328977e-06,
      "loss": 0.0859,
      "mae_dtheta": 0.008235122077167034,
      "mae_dx": 0.0014632284874096513,
      "mae_dy": 0.0020441438537091017,
      "pose_mae_dtheta": 0.05595187097787857,
      "pose_mae_dx": 0.021548433229327202,
      "pose_mae_dy": 0.022640269249677658,
      "pose_rmse_dtheta": 0.14989669620990753,
      "pose_rmse_dx": 0.0619114488363266,
      "pose_rmse_dy": 0.05145977437496185,
      "pose_rmse_mean": 0.08775597810745239,
      "rmse_dtheta": 0.020889708772301674,
      "rmse_dx": 0.004097446799278259,
      "rmse_dy": 0.00502672279253602,
      "rmse_mean": 0.010004626587033272,
      "rotation_flip": 0.0029812606517225504,
      "sparse_tokens": 32105.0,
      "step": 8915,
      "turn_loss": 0.08020789921283722,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.41423527225422785,
      "grad_norm": 0.437439888715744,
      "learning_rate": 1.5736035453014515e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.01020850706845522,
      "mae_dx": 0.0020656385459005833,
      "mae_dy": 0.0019902766216546297,
      "pose_mae_dtheta": 0.07266627252101898,
      "pose_mae_dx": 0.022660914808511734,
      "pose_mae_dy": 0.022764166817069054,
      "pose_rmse_dtheta": 0.20878352224826813,
      "pose_rmse_dx": 0.058445777744054794,
      "pose_rmse_dy": 0.060777533799409866,
      "pose_rmse_mean": 0.10933561623096466,
      "rmse_dtheta": 0.026344601064920425,
      "rmse_dx": 0.006190515123307705,
      "rmse_dy": 0.005146514158695936,
      "rmse_mean": 0.012560544535517693,
      "rotation_flip": 0.007649158593267202,
      "sparse_tokens": 32137.0,
      "step": 8916,
      "turn_loss": 0.10200703144073486,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4142817320200706,
      "grad_norm": 0.46786749362945557,
      "learning_rate": 1.5726407188836672e-06,
      "loss": 0.0774,
      "mae_dtheta": 0.00874099787324667,
      "mae_dx": 0.0015059116994962096,
      "mae_dy": 0.001955288928002119,
      "pose_mae_dtheta": 0.0587986595928669,
      "pose_mae_dx": 0.01564900018274784,
      "pose_mae_dy": 0.020638003945350647,
      "pose_rmse_dtheta": 0.15793105959892273,
      "pose_rmse_dx": 0.04006950184702873,
      "pose_rmse_dy": 0.044915907084941864,
      "pose_rmse_mean": 0.08097215741872787,
      "rmse_dtheta": 0.01947961188852787,
      "rmse_dx": 0.0044655101373791695,
      "rmse_dy": 0.00496889790520072,
      "rmse_mean": 0.00963800773024559,
      "rotation_flip": 0.004140786826610565,
      "sparse_tokens": 32169.0,
      "step": 8917,
      "turn_loss": 0.06835126876831055,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.4143281917859134,
      "grad_norm": 0.45189905166625977,
      "learning_rate": 1.571678132142957e-06,
      "loss": 0.0876,
      "mae_dtheta": 0.040637653321027756,
      "mae_dx": 0.021190764382481575,
      "mae_dy": 0.007710439618676901,
      "pose_mae_dtheta": 0.3465873599052429,
      "pose_mae_dx": 0.14353631436824799,
      "pose_mae_dy": 0.09539598226547241,
      "pose_rmse_dtheta": 0.5851384997367859,
      "pose_rmse_dx": 0.28971734642982483,
      "pose_rmse_dy": 0.20034995675086975,
      "pose_rmse_mean": 0.35840195417404175,
      "rmse_dtheta": 0.0588475838303566,
      "rmse_dx": 0.03512320667505264,
      "rmse_dy": 0.01379514578729868,
      "rmse_mean": 0.03592197969555855,
      "rotation_flip": 0.0066225165501236916,
      "sparse_tokens": 5719.0,
      "step": 8918,
      "turn_loss": 0.3944001793861389,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4143746515517562,
      "grad_norm": 0.44363105297088623,
      "learning_rate": 1.5707157851466371e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.009932034648954868,
      "mae_dx": 0.0018753967015072703,
      "mae_dy": 0.0030729719437658787,
      "pose_mae_dtheta": 0.0680856928229332,
      "pose_mae_dx": 0.022608546540141106,
      "pose_mae_dy": 0.028665320947766304,
      "pose_rmse_dtheta": 0.15744318068027496,
      "pose_rmse_dx": 0.05402800813317299,
      "pose_rmse_dy": 0.062478259205818176,
      "pose_rmse_mean": 0.09131648391485214,
      "rmse_dtheta": 0.02154817059636116,
      "rmse_dx": 0.005713308230042458,
      "rmse_dy": 0.007529719267040491,
      "rmse_mean": 0.011597066186368465,
      "rotation_flip": 0.0057848053984344006,
      "sparse_tokens": 32105.0,
      "step": 8919,
      "turn_loss": 0.0961688831448555,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.41442111131759896,
      "grad_norm": 0.6380963921546936,
      "learning_rate": 1.569753677962001e-06,
      "loss": 0.185,
      "mae_dtheta": 0.008778806775808334,
      "mae_dx": 0.001987069845199585,
      "mae_dy": 0.0016969401622191072,
      "pose_mae_dtheta": 0.055411070585250854,
      "pose_mae_dx": 0.01923084631562233,
      "pose_mae_dy": 0.018636206164956093,
      "pose_rmse_dtheta": 0.15814319252967834,
      "pose_rmse_dx": 0.04987054690718651,
      "pose_rmse_dy": 0.04867897927761078,
      "pose_rmse_mean": 0.08556424081325531,
      "rmse_dtheta": 0.020921679213643074,
      "rmse_dx": 0.005904891062527895,
      "rmse_dy": 0.004566940478980541,
      "rmse_mean": 0.010464503429830074,
      "rotation_flip": 0.00569476094096899,
      "sparse_tokens": 32137.0,
      "step": 8920,
      "turn_loss": 0.09460042417049408,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.41446757108344173,
      "grad_norm": 0.6394762396812439,
      "learning_rate": 1.5687918106563326e-06,
      "loss": 0.1419,
      "mae_dtheta": 0.0065752132795751095,
      "mae_dx": 0.0011308133834972978,
      "mae_dy": 0.0011476095532998443,
      "pose_mae_dtheta": 0.046383894979953766,
      "pose_mae_dx": 0.010438874363899231,
      "pose_mae_dy": 0.01593584008514881,
      "pose_rmse_dtheta": 0.15181134641170502,
      "pose_rmse_dx": 0.03106790781021118,
      "pose_rmse_dy": 0.04230356961488724,
      "pose_rmse_mean": 0.07506094872951508,
      "rmse_dtheta": 0.018682485446333885,
      "rmse_dx": 0.003976602107286453,
      "rmse_dy": 0.0032199823763221502,
      "rmse_mean": 0.008626356720924377,
      "rotation_flip": 0.003213711781427264,
      "sparse_tokens": 32073.0,
      "step": 8921,
      "turn_loss": 0.05419933423399925,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.4145140308492845,
      "grad_norm": 1.0060181617736816,
      "learning_rate": 1.567830183296894e-06,
      "loss": 0.2724,
      "mae_dtheta": 0.04595405235886574,
      "mae_dx": 0.013691078871488571,
      "mae_dy": 0.006425624713301659,
      "pose_mae_dtheta": 0.3961832821369171,
      "pose_mae_dx": 0.11170375347137451,
      "pose_mae_dy": 0.06809224933385849,
      "pose_rmse_dtheta": 0.6581121683120728,
      "pose_rmse_dx": 0.2406177669763565,
      "pose_rmse_dy": 0.18033438920974731,
      "pose_rmse_mean": 0.3596881330013275,
      "rmse_dtheta": 0.06536636501550674,
      "rmse_dx": 0.026346102356910706,
      "rmse_dy": 0.015967722982168198,
      "rmse_mean": 0.03589339554309845,
      "rotation_flip": 0.012403100728988647,
      "sparse_tokens": 21611.0,
      "step": 8922,
      "turn_loss": 0.36969444155693054,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4145604906151273,
      "grad_norm": 0.5680640339851379,
      "learning_rate": 1.566868795950932e-06,
      "loss": 0.1445,
      "mae_dtheta": 0.008089933544397354,
      "mae_dx": 0.001091453363187611,
      "mae_dy": 0.0014417407801374793,
      "pose_mae_dtheta": 0.0551333874464035,
      "pose_mae_dx": 0.014468878507614136,
      "pose_mae_dy": 0.020308278501033783,
      "pose_rmse_dtheta": 0.1783260554075241,
      "pose_rmse_dx": 0.03925224766135216,
      "pose_rmse_dy": 0.055246856063604355,
      "pose_rmse_mean": 0.09094171971082687,
      "rmse_dtheta": 0.021619614213705063,
      "rmse_dx": 0.003558770753443241,
      "rmse_dy": 0.0033321687951684,
      "rmse_mean": 0.009503517299890518,
      "rotation_flip": 0.0014402304077520967,
      "sparse_tokens": 32089.0,
      "step": 8923,
      "turn_loss": 0.06711345911026001,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.41460695038097006,
      "grad_norm": 0.5234147310256958,
      "learning_rate": 1.5659076486856794e-06,
      "loss": 0.107,
      "mae_dtheta": 0.030658336356282234,
      "mae_dx": 0.008169665932655334,
      "mae_dy": 0.006473825313150883,
      "pose_mae_dtheta": 0.18514588475227356,
      "pose_mae_dx": 0.06620153784751892,
      "pose_mae_dy": 0.06541196256875992,
      "pose_rmse_dtheta": 0.299827516078949,
      "pose_rmse_dx": 0.1367802619934082,
      "pose_rmse_dy": 0.15393616259098053,
      "pose_rmse_mean": 0.19684797525405884,
      "rmse_dtheta": 0.04899065941572189,
      "rmse_dx": 0.017248032614588737,
      "rmse_dy": 0.01188401784747839,
      "rmse_mean": 0.026040904223918915,
      "rotation_flip": 0.023872679099440575,
      "sparse_tokens": 6759.0,
      "step": 8924,
      "turn_loss": 0.2872576415538788,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 32763.0,
      "epoch": 0.41465341014681284,
      "grad_norm": 1.0550668239593506,
      "learning_rate": 1.5649467415683467e-06,
      "loss": 0.2843,
      "mae_dtheta": 0.030939102172851562,
      "mae_dx": 0.01306752860546112,
      "mae_dy": 0.0051642549224197865,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999989867210388,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.24862670898438,
      "model/head/act_norm_mean": 99.34613822710396,
      "model/head/act_norm_min": 66.82353210449219,
      "model/head/act_over_embed": 68.27159628286579,
      "model/head/grad_frac": 0.11909008771181107,
      "model/head/grad_norm": 0.11908996850252151,
      "model/head/grad_zero_frac": 0.0001649813202675432,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6896271658415841,
      "model/head/update_ratio": 0.002028030576184392,
      "model/head/weight_delta": 9.847443580627441,
      "model/head/weight_delta_rel": 0.17275333404541016,
      "model/head/weight_norm": 58.721981048583984,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4225679039955139,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4225045372458065,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4224291443824768,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29034907354511663,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0739249512553215,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07392487674951553,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5277841605392157,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002387111773714423,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1284615993499756,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10221659392118454,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968334197998047,
      "model/modality_embedder/grad_frac": 0.0739249512553215,
      "model/modality_embedder/grad_norm": 0.07392487674951553,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5277841605392157,
      "model/modality_embedder/update_ratio": 0.002387111773714423,
      "model/modality_embedder/weight_delta": 3.1284615993499756,
      "model/modality_embedder/weight_delta_rel": 0.10221659392118454,
      "model/modality_embedder/weight_norm": 30.968334197998047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.62843322753906,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.654784005186233,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.316317558288574,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.568579665793486,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08264075964689255,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.08264067769050598,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0029572732746601105,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.67171049118042,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09735874086618423,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.94489097595215,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.92101287841797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.429534024831053,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.725767135620117,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.100995132617367,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07959359139204025,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07959350943565369,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002675840863958001,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3870482444763184,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11732999980449677,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.74523162841797,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.97782897949219,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.000906117397452,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.880565643310547,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.18085674604631,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07833225280046463,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07833217084407806,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002550258534029126,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.665740489959717,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12308870255947113,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.715383529663086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.57324981689453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.877563649222065,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.857759475708008,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.47051337146081,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06884470582008362,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06884463876485825,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022998542990535498,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1457245349884033,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10750593990087509,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.93434715270996,
      "model/normalizer/grad_frac": 0.28444045782089233,
      "model/normalizer/grad_norm": 0.28444015979766846,
      "model/normalizer/grad_zero_frac": 0.00023398420307785273,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0036174857523292303,
      "model/normalizer/weight_delta": 6.627069473266602,
      "model/normalizer/weight_delta_rel": 0.0853528156876564,
      "model/normalizer/weight_norm": 78.62924194335938,
      "pose_mae_dtheta": 0.2333020120859146,
      "pose_mae_dx": 0.11166136711835861,
      "pose_mae_dy": 0.06463547050952911,
      "pose_rmse_dtheta": 0.4083246886730194,
      "pose_rmse_dx": 0.24279272556304932,
      "pose_rmse_dy": 0.15518878400325775,
      "pose_rmse_mean": 0.2687687575817108,
      "rmse_dtheta": 0.0475175715982914,
      "rmse_dx": 0.025851691141724586,
      "rmse_dy": 0.011789379641413689,
      "rmse_mean": 0.02838621661067009,
      "rotation_flip": 0.007323568686842918,
      "sparse_tokens": 25031.0,
      "step": 8925,
      "turn_loss": 0.2803667187690735,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4146998699126556,
      "grad_norm": 0.38207897543907166,
      "learning_rate": 1.5639860746661339e-06,
      "loss": 0.0955,
      "mae_dtheta": 0.007275845855474472,
      "mae_dx": 0.0010124893160536885,
      "mae_dy": 0.0015549147501587868,
      "pose_mae_dtheta": 0.04396287724375725,
      "pose_mae_dx": 0.013518241234123707,
      "pose_mae_dy": 0.016635913401842117,
      "pose_rmse_dtheta": 0.1347077190876007,
      "pose_rmse_dx": 0.03408666327595711,
      "pose_rmse_dy": 0.03740798309445381,
      "pose_rmse_mean": 0.06873412430286407,
      "rmse_dtheta": 0.018640534952282906,
      "rmse_dx": 0.002796696964651346,
      "rmse_dy": 0.0034719514660537243,
      "rmse_mean": 0.008303061127662659,
      "rotation_flip": 0.001722652930766344,
      "sparse_tokens": 32105.0,
      "step": 8926,
      "turn_loss": 0.06082965433597565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4147463296784984,
      "grad_norm": 0.40694499015808105,
      "learning_rate": 1.5630256480462168e-06,
      "loss": 0.1022,
      "mae_dtheta": 0.008664827793836594,
      "mae_dx": 0.0015627893153578043,
      "mae_dy": 0.0017384198727086186,
      "pose_mae_dtheta": 0.06056253984570503,
      "pose_mae_dx": 0.02008834294974804,
      "pose_mae_dy": 0.020425736904144287,
      "pose_rmse_dtheta": 0.1714736670255661,
      "pose_rmse_dx": 0.049907028675079346,
      "pose_rmse_dy": 0.051064632833004,
      "pose_rmse_mean": 0.09081511199474335,
      "rmse_dtheta": 0.021914498880505562,
      "rmse_dx": 0.004922892432659864,
      "rmse_dy": 0.003958184737712145,
      "rmse_mean": 0.01026519201695919,
      "rotation_flip": 0.002935420721769333,
      "sparse_tokens": 32057.0,
      "step": 8927,
      "turn_loss": 0.06960062682628632,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.4147927894443412,
      "grad_norm": 0.4079371690750122,
      "learning_rate": 1.5620654617757636e-06,
      "loss": 0.0822,
      "mae_dtheta": 0.03526564687490463,
      "mae_dx": 0.009210574440658092,
      "mae_dy": 0.006530753802508116,
      "pose_mae_dtheta": 0.2862618863582611,
      "pose_mae_dx": 0.09773293882608414,
      "pose_mae_dy": 0.05974037945270538,
      "pose_rmse_dtheta": 0.5312058329582214,
      "pose_rmse_dx": 0.24988588690757751,
      "pose_rmse_dy": 0.1624048799276352,
      "pose_rmse_mean": 0.3144988715648651,
      "rmse_dtheta": 0.05702899768948555,
      "rmse_dx": 0.020661767572164536,
      "rmse_dy": 0.016785884276032448,
      "rmse_mean": 0.031492218375205994,
      "rotation_flip": 0.012019230984151363,
      "sparse_tokens": 6631.0,
      "step": 8928,
      "turn_loss": 0.21105700731277466,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.414839249210184,
      "grad_norm": 0.6150780916213989,
      "learning_rate": 1.561105515921915e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.009888012893497944,
      "mae_dx": 0.0011747117387130857,
      "mae_dy": 0.002351420931518078,
      "pose_mae_dtheta": 0.06346477568149567,
      "pose_mae_dx": 0.01877015084028244,
      "pose_mae_dy": 0.028347501531243324,
      "pose_rmse_dtheta": 0.1629742830991745,
      "pose_rmse_dx": 0.04559152200818062,
      "pose_rmse_dy": 0.06282395124435425,
      "pose_rmse_mean": 0.09046325087547302,
      "rmse_dtheta": 0.021343199536204338,
      "rmse_dx": 0.00344290304929018,
      "rmse_dy": 0.004826660268008709,
      "rmse_mean": 0.009870922192931175,
      "rotation_flip": 0.0038284838665276766,
      "sparse_tokens": 32041.0,
      "step": 8929,
      "turn_loss": 0.07721272855997086,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4148857089760268,
      "grad_norm": 0.3860236704349518,
      "learning_rate": 1.5601458105518047e-06,
      "loss": 0.1066,
      "mae_dtheta": 0.011901231482625008,
      "mae_dx": 0.0032678362913429737,
      "mae_dy": 0.0021902916487306356,
      "pose_mae_dtheta": 0.08064880967140198,
      "pose_mae_dx": 0.03009098395705223,
      "pose_mae_dy": 0.0210281852632761,
      "pose_rmse_dtheta": 0.21983829140663147,
      "pose_rmse_dx": 0.11077885329723358,
      "pose_rmse_dy": 0.051009662449359894,
      "pose_rmse_mean": 0.12720893323421478,
      "rmse_dtheta": 0.02938034012913704,
      "rmse_dx": 0.01161638367921114,
      "rmse_dy": 0.005497349426150322,
      "rmse_mean": 0.015498025342822075,
      "rotation_flip": 0.009923320263624191,
      "sparse_tokens": 32121.0,
      "step": 8930,
      "turn_loss": 0.1463368684053421,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22972.0,
      "epoch": 0.41493216874186956,
      "grad_norm": 0.7703374028205872,
      "learning_rate": 1.5591863457325452e-06,
      "loss": 0.2043,
      "mae_dtheta": 0.03255278244614601,
      "mae_dx": 0.011075989343225956,
      "mae_dy": 0.009433123283088207,
      "pose_mae_dtheta": 0.2036081999540329,
      "pose_mae_dx": 0.08115199953317642,
      "pose_mae_dy": 0.10202959924936295,
      "pose_rmse_dtheta": 0.3356616795063019,
      "pose_rmse_dx": 0.18651582300662994,
      "pose_rmse_dy": 0.20230726897716522,
      "pose_rmse_mean": 0.24149493873119354,
      "rmse_dtheta": 0.047288019210100174,
      "rmse_dx": 0.023914555087685585,
      "rmse_dy": 0.01623920165002346,
      "rmse_mean": 0.029147259891033173,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 18632.0,
      "step": 8931,
      "turn_loss": 0.324562132358551,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.41497862850771233,
      "grad_norm": 0.6107488870620728,
      "learning_rate": 1.5582271215312294e-06,
      "loss": 0.219,
      "mae_dtheta": 0.06961390376091003,
      "mae_dx": 0.030210165306925774,
      "mae_dy": 0.02334011159837246,
      "pose_mae_dtheta": 0.600914716720581,
      "pose_mae_dx": 0.2053920030593872,
      "pose_mae_dy": 0.20055732131004333,
      "pose_rmse_dtheta": 0.8790611624717712,
      "pose_rmse_dx": 0.35325348377227783,
      "pose_rmse_dy": 0.36227279901504517,
      "pose_rmse_mean": 0.5315291285514832,
      "rmse_dtheta": 0.08946729451417923,
      "rmse_dx": 0.043305572122335434,
      "rmse_dy": 0.03468292951583862,
      "rmse_mean": 0.055818598717451096,
      "rotation_flip": 0.026385223492980003,
      "sparse_tokens": 6334.0,
      "step": 8932,
      "turn_loss": 0.9882506728172302,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.4150250882735551,
      "grad_norm": 0.5640199780464172,
      "learning_rate": 1.5572681380149401e-06,
      "loss": 0.105,
      "mae_dtheta": 0.02531786821782589,
      "mae_dx": 0.007574102375656366,
      "mae_dy": 0.0046534352004528046,
      "pose_mae_dtheta": 0.17420747876167297,
      "pose_mae_dx": 0.06108786538243294,
      "pose_mae_dy": 0.04506661742925644,
      "pose_rmse_dtheta": 0.33261638879776,
      "pose_rmse_dx": 0.18153125047683716,
      "pose_rmse_dy": 0.11883014440536499,
      "pose_rmse_mean": 0.21099260449409485,
      "rmse_dtheta": 0.040197908878326416,
      "rmse_dx": 0.02039768546819687,
      "rmse_dy": 0.009943935088813305,
      "rmse_mean": 0.023513175547122955,
      "rotation_flip": 0.016605166718363762,
      "sparse_tokens": 8855.0,
      "step": 8933,
      "turn_loss": 0.1835671365261078,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4150715480393979,
      "grad_norm": 0.5266374349594116,
      "learning_rate": 1.5563093952507363e-06,
      "loss": 0.1276,
      "mae_dtheta": 0.009242993779480457,
      "mae_dx": 0.0027333085890859365,
      "mae_dy": 0.0032188305631279945,
      "pose_mae_dtheta": 0.06313291937112808,
      "pose_mae_dx": 0.029755670577287674,
      "pose_mae_dy": 0.025545379146933556,
      "pose_rmse_dtheta": 0.17622390389442444,
      "pose_rmse_dx": 0.08712361007928848,
      "pose_rmse_dy": 0.056536462157964706,
      "pose_rmse_mean": 0.10662799328565598,
      "rmse_dtheta": 0.021578460931777954,
      "rmse_dx": 0.007401563227176666,
      "rmse_dy": 0.007351632229983807,
      "rmse_mean": 0.012110552750527859,
      "rotation_flip": 0.009562338702380657,
      "sparse_tokens": 32121.0,
      "step": 8934,
      "turn_loss": 0.09120049327611923,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.41511800780524066,
      "grad_norm": 0.5558252334594727,
      "learning_rate": 1.5553508933056665e-06,
      "loss": 0.1311,
      "mae_dtheta": 0.008410628885030746,
      "mae_dx": 0.001483601750805974,
      "mae_dy": 0.0023075465578585863,
      "pose_mae_dtheta": 0.05407145991921425,
      "pose_mae_dx": 0.019428526982665062,
      "pose_mae_dy": 0.025974057614803314,
      "pose_rmse_dtheta": 0.1016005277633667,
      "pose_rmse_dx": 0.06295354664325714,
      "pose_rmse_dy": 0.06111987680196762,
      "pose_rmse_mean": 0.07522465288639069,
      "rmse_dtheta": 0.01699434407055378,
      "rmse_dx": 0.004789803177118301,
      "rmse_dy": 0.005418084096163511,
      "rmse_mean": 0.009067410603165627,
      "rotation_flip": 0.007766103371977806,
      "sparse_tokens": 32073.0,
      "step": 8935,
      "turn_loss": 0.08083797991275787,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.41516446757108344,
      "grad_norm": 0.5263391733169556,
      "learning_rate": 1.5543926322467562e-06,
      "loss": 0.0881,
      "mae_dtheta": 0.021829072386026382,
      "mae_dx": 0.004969424568116665,
      "mae_dy": 0.0037589087150990963,
      "pose_mae_dtheta": 0.16113285720348358,
      "pose_mae_dx": 0.038150470703840256,
      "pose_mae_dy": 0.03925970569252968,
      "pose_rmse_dtheta": 0.306953102350235,
      "pose_rmse_dx": 0.10112117975950241,
      "pose_rmse_dy": 0.09399932622909546,
      "pose_rmse_mean": 0.1673578917980194,
      "rmse_dtheta": 0.037039630115032196,
      "rmse_dx": 0.012544640339910984,
      "rmse_dy": 0.008311668410897255,
      "rmse_mean": 0.019298646599054337,
      "rotation_flip": 0.013779527507722378,
      "sparse_tokens": 8468.0,
      "step": 8936,
      "turn_loss": 0.15153397619724274,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4152109273369262,
      "grad_norm": 0.489435613155365,
      "learning_rate": 1.5534346121410193e-06,
      "loss": 0.0979,
      "mae_dtheta": 0.009690157137811184,
      "mae_dx": 0.0018826659070327878,
      "mae_dy": 0.0027106376364827156,
      "pose_mae_dtheta": 0.06266076862812042,
      "pose_mae_dx": 0.025423210114240646,
      "pose_mae_dy": 0.02713334560394287,
      "pose_rmse_dtheta": 0.13404874503612518,
      "pose_rmse_dx": 0.07201259583234787,
      "pose_rmse_dy": 0.06806212663650513,
      "pose_rmse_mean": 0.0913744866847992,
      "rmse_dtheta": 0.020453844219446182,
      "rmse_dx": 0.005849113687872887,
      "rmse_dy": 0.007316756062209606,
      "rmse_mean": 0.011206571012735367,
      "rotation_flip": 0.0060901339165866375,
      "sparse_tokens": 32073.0,
      "step": 8937,
      "turn_loss": 0.07977475970983505,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.415257387102769,
      "grad_norm": 0.6201976537704468,
      "learning_rate": 1.5524768330554507e-06,
      "loss": 0.1772,
      "mae_dtheta": 0.0295732282102108,
      "mae_dx": 0.008832735009491444,
      "mae_dy": 0.004676916636526585,
      "pose_mae_dtheta": 0.23174619674682617,
      "pose_mae_dx": 0.055747512727975845,
      "pose_mae_dy": 0.08037463575601578,
      "pose_rmse_dtheta": 0.45138582587242126,
      "pose_rmse_dx": 0.11629030853509903,
      "pose_rmse_dy": 0.15844203531742096,
      "pose_rmse_mean": 0.24203938245773315,
      "rmse_dtheta": 0.04840988293290138,
      "rmse_dx": 0.02002987451851368,
      "rmse_dy": 0.007951253093779087,
      "rmse_mean": 0.02546367049217224,
      "rotation_flip": 0.010075566358864307,
      "sparse_tokens": 7718.0,
      "step": 8938,
      "turn_loss": 0.1543373167514801,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.41530384686861177,
      "grad_norm": 0.546143651008606,
      "learning_rate": 1.5515192950570257e-06,
      "loss": 0.0798,
      "mae_dtheta": 0.03785545378923416,
      "mae_dx": 0.009630812332034111,
      "mae_dy": 0.0016445101937279105,
      "pose_mae_dtheta": 0.3045296370983124,
      "pose_mae_dx": 0.06726814061403275,
      "pose_mae_dy": 0.01168454997241497,
      "pose_rmse_dtheta": 0.6022326350212097,
      "pose_rmse_dx": 0.17456282675266266,
      "pose_rmse_dy": 0.025908740237355232,
      "pose_rmse_mean": 0.26756808161735535,
      "rmse_dtheta": 0.0633092150092125,
      "rmse_dx": 0.02132287435233593,
      "rmse_dy": 0.004158381372690201,
      "rmse_mean": 0.029596826061606407,
      "rotation_flip": 0.012658228166401386,
      "sparse_tokens": 5246.0,
      "step": 8939,
      "turn_loss": 0.18811191618442535,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.41535030663445455,
      "grad_norm": 0.39792370796203613,
      "learning_rate": 1.5505619982127084e-06,
      "loss": 0.0932,
      "mae_dtheta": 0.030983928591012955,
      "mae_dx": 0.00680333748459816,
      "mae_dy": 0.0057389200665056705,
      "pose_mae_dtheta": 0.253059983253479,
      "pose_mae_dx": 0.07252992689609528,
      "pose_mae_dy": 0.09955863654613495,
      "pose_rmse_dtheta": 0.4272270202636719,
      "pose_rmse_dx": 0.17485322058200836,
      "pose_rmse_dy": 0.20210060477256775,
      "pose_rmse_mean": 0.2680602967739105,
      "rmse_dtheta": 0.046463318169116974,
      "rmse_dx": 0.018071750178933144,
      "rmse_dy": 0.009521734900772572,
      "rmse_mean": 0.024685602635145187,
      "rotation_flip": 0.012280701659619808,
      "sparse_tokens": 11740.0,
      "step": 8940,
      "turn_loss": 0.22482362389564514,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.4153967664002973,
      "grad_norm": 0.8684747219085693,
      "learning_rate": 1.549604942589441e-06,
      "loss": 0.1851,
      "mae_dtheta": 0.03144627436995506,
      "mae_dx": 0.010196556337177753,
      "mae_dy": 0.004226784221827984,
      "pose_mae_dtheta": 0.2492266744375229,
      "pose_mae_dx": 0.07685587555170059,
      "pose_mae_dy": 0.05010973662137985,
      "pose_rmse_dtheta": 0.4733971357345581,
      "pose_rmse_dx": 0.17488175630569458,
      "pose_rmse_dy": 0.13563407957553864,
      "pose_rmse_mean": 0.2613043189048767,
      "rmse_dtheta": 0.0512404590845108,
      "rmse_dx": 0.021984143182635307,
      "rmse_dy": 0.008871245197951794,
      "rmse_mean": 0.02736528217792511,
      "rotation_flip": 0.010791366919875145,
      "sparse_tokens": 19932.0,
      "step": 8941,
      "turn_loss": 0.25542035698890686,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 30400.0,
      "epoch": 0.4154432261661401,
      "grad_norm": 0.5421983599662781,
      "learning_rate": 1.5486481282541516e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.032702259719371796,
      "mae_dx": 0.01145333144813776,
      "mae_dy": 0.004392213653773069,
      "pose_mae_dtheta": 0.2514900267124176,
      "pose_mae_dx": 0.09342456609010696,
      "pose_mae_dy": 0.0568687878549099,
      "pose_rmse_dtheta": 0.4666815996170044,
      "pose_rmse_dx": 0.20956425368785858,
      "pose_rmse_dy": 0.1407943069934845,
      "pose_rmse_mean": 0.27234673500061035,
      "rmse_dtheta": 0.0507691353559494,
      "rmse_dx": 0.02375895529985428,
      "rmse_dy": 0.008499274030327797,
      "rmse_mean": 0.02767578884959221,
      "rotation_flip": 0.014232209883630276,
      "sparse_tokens": 23084.0,
      "step": 8942,
      "turn_loss": 0.2396964281797409,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4154896859319829,
      "grad_norm": 0.3627050518989563,
      "learning_rate": 1.5476915552737532e-06,
      "loss": 0.0993,
      "mae_dtheta": 0.007164790295064449,
      "mae_dx": 0.001640395843423903,
      "mae_dy": 0.0016170203452929854,
      "pose_mae_dtheta": 0.050768956542015076,
      "pose_mae_dx": 0.01341275591403246,
      "pose_mae_dy": 0.0166824571788311,
      "pose_rmse_dtheta": 0.17900747060775757,
      "pose_rmse_dx": 0.03907233476638794,
      "pose_rmse_dy": 0.04326927289366722,
      "pose_rmse_mean": 0.08711636066436768,
      "rmse_dtheta": 0.02010650746524334,
      "rmse_dx": 0.0067495377734303474,
      "rmse_dy": 0.005376353394240141,
      "rmse_mean": 0.010744133964180946,
      "rotation_flip": 0.0050855292938649654,
      "sparse_tokens": 32105.0,
      "step": 8943,
      "turn_loss": 0.061218395829200745,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4155361456978257,
      "grad_norm": 0.48918139934539795,
      "learning_rate": 1.546735223715135e-06,
      "loss": 0.1118,
      "mae_dtheta": 0.0070947338826954365,
      "mae_dx": 0.001306814723648131,
      "mae_dy": 0.0018363258568570018,
      "pose_mae_dtheta": 0.045890577137470245,
      "pose_mae_dx": 0.01824723370373249,
      "pose_mae_dy": 0.02052178792655468,
      "pose_rmse_dtheta": 0.11099008470773697,
      "pose_rmse_dx": 0.049613092094659805,
      "pose_rmse_dy": 0.05725942924618721,
      "pose_rmse_mean": 0.07262086868286133,
      "rmse_dtheta": 0.016024025157094002,
      "rmse_dx": 0.003733719466254115,
      "rmse_dy": 0.004485951736569405,
      "rmse_mean": 0.008081232197582722,
      "rotation_flip": 0.0016116035403683782,
      "sparse_tokens": 32105.0,
      "step": 8944,
      "turn_loss": 0.051749151200056076,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4155826054636685,
      "grad_norm": 0.4879840314388275,
      "learning_rate": 1.5457791336451777e-06,
      "loss": 0.109,
      "mae_dtheta": 0.007813490927219391,
      "mae_dx": 0.0012347176671028137,
      "mae_dy": 0.0015664001693949103,
      "pose_mae_dtheta": 0.04783032834529877,
      "pose_mae_dx": 0.01441820990294218,
      "pose_mae_dy": 0.018388893455266953,
      "pose_rmse_dtheta": 0.12242989987134933,
      "pose_rmse_dx": 0.0437232069671154,
      "pose_rmse_dy": 0.0429580882191658,
      "pose_rmse_mean": 0.06970372796058655,
      "rmse_dtheta": 0.01894315890967846,
      "rmse_dx": 0.0033536939881742,
      "rmse_dy": 0.003902785712853074,
      "rmse_mean": 0.008733212947845459,
      "rotation_flip": 0.0033320991788059473,
      "sparse_tokens": 32169.0,
      "step": 8945,
      "turn_loss": 0.05861174315214157,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.41562906522951126,
      "grad_norm": 0.4383865296840668,
      "learning_rate": 1.5448232851307388e-06,
      "loss": 0.0934,
      "mae_dtheta": 0.010915221646428108,
      "mae_dx": 0.0019259321270510554,
      "mae_dy": 0.002418488496914506,
      "pose_mae_dtheta": 0.07571138441562653,
      "pose_mae_dx": 0.023977205157279968,
      "pose_mae_dy": 0.024856729432940483,
      "pose_rmse_dtheta": 0.20095163583755493,
      "pose_rmse_dx": 0.06087218225002289,
      "pose_rmse_dy": 0.05878530070185661,
      "pose_rmse_mean": 0.10686971247196198,
      "rmse_dtheta": 0.024769611656665802,
      "rmse_dx": 0.005379078909754753,
      "rmse_dy": 0.005600977223366499,
      "rmse_mean": 0.01191655546426773,
      "rotation_flip": 0.001884658820927143,
      "sparse_tokens": 32121.0,
      "step": 8946,
      "turn_loss": 0.08510759472846985,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.41567552499535404,
      "grad_norm": 0.6875590085983276,
      "learning_rate": 1.543867678238663e-06,
      "loss": 0.1619,
      "mae_dtheta": 0.011640836484730244,
      "mae_dx": 0.0028023060876876116,
      "mae_dy": 0.003766116686165333,
      "pose_mae_dtheta": 0.073263019323349,
      "pose_mae_dx": 0.02835819683969021,
      "pose_mae_dy": 0.030364252626895905,
      "pose_rmse_dtheta": 0.17599421739578247,
      "pose_rmse_dx": 0.07686587423086166,
      "pose_rmse_dy": 0.0698075219988823,
      "pose_rmse_mean": 0.10755588114261627,
      "rmse_dtheta": 0.023494724184274673,
      "rmse_dx": 0.008134852163493633,
      "rmse_dy": 0.009012928232550621,
      "rmse_mean": 0.01354750245809555,
      "rotation_flip": 0.005540166050195694,
      "sparse_tokens": 32121.0,
      "step": 8947,
      "turn_loss": 0.1280628740787506,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28785.0,
      "epoch": 0.4157219847611968,
      "grad_norm": 0.5637945532798767,
      "learning_rate": 1.5429123130357738e-06,
      "loss": 0.1972,
      "mae_dtheta": 0.031116832047700882,
      "mae_dx": 0.014290801249444485,
      "mae_dy": 0.006478032097220421,
      "pose_mae_dtheta": 0.27094823122024536,
      "pose_mae_dx": 0.13035692274570465,
      "pose_mae_dy": 0.0813787579536438,
      "pose_rmse_dtheta": 0.4530266225337982,
      "pose_rmse_dx": 0.2644096910953522,
      "pose_rmse_dy": 0.17704683542251587,
      "pose_rmse_mean": 0.2981610596179962,
      "rmse_dtheta": 0.0470607616007328,
      "rmse_dx": 0.02700909972190857,
      "rmse_dy": 0.01259731873869896,
      "rmse_mean": 0.028889060020446777,
      "rotation_flip": 0.00804289523512125,
      "sparse_tokens": 22508.0,
      "step": 8948,
      "turn_loss": 0.3335307836532593,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4157684445270396,
      "grad_norm": 0.5060158967971802,
      "learning_rate": 1.5419571895888823e-06,
      "loss": 0.1358,
      "mae_dtheta": 0.009220561012625694,
      "mae_dx": 0.0014421328669413924,
      "mae_dy": 0.002149512292817235,
      "pose_mae_dtheta": 0.05172060802578926,
      "pose_mae_dx": 0.018997006118297577,
      "pose_mae_dy": 0.020316284149885178,
      "pose_rmse_dtheta": 0.10539890080690384,
      "pose_rmse_dx": 0.04741565138101578,
      "pose_rmse_dy": 0.042693305760622025,
      "pose_rmse_mean": 0.06516928970813751,
      "rmse_dtheta": 0.017676496878266335,
      "rmse_dx": 0.004598086699843407,
      "rmse_dy": 0.0041509042493999004,
      "rmse_mean": 0.008808496408164501,
      "rotation_flip": 0.008229098282754421,
      "sparse_tokens": 32121.0,
      "step": 8949,
      "turn_loss": 0.07371123880147934,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.41581490429288237,
      "grad_norm": 0.43947741389274597,
      "learning_rate": 1.5410023079647823e-06,
      "loss": 0.0992,
      "mae_dtheta": 0.02499908208847046,
      "mae_dx": 0.007803803309798241,
      "mae_dy": 0.003613159991800785,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4394775629043579,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 166.50144958496094,
      "model/head/act_norm_mean": 108.6768897804054,
      "model/head/act_norm_min": 62.30165481567383,
      "model/head/act_over_embed": 74.68377610616689,
      "model/head/grad_frac": 0.09980909526348114,
      "model/head/grad_norm": 0.04386385902762413,
      "model/head/grad_zero_frac": 0.00020273665722925216,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.695484058277027,
      "model/head/update_ratio": 0.0007469658739864826,
      "model/head/weight_delta": 9.850921630859375,
      "model/head/weight_delta_rel": 0.17281433939933777,
      "model/head/weight_norm": 58.72270965576172,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42259088158607483,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4225194803873698,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4224716126918793,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29035934261189883,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11085032671689987,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0487162321805954,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5237760416666667,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015730884624645114,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1306557655334473,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10228828340768814,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96852684020996,
      "model/modality_embedder/grad_frac": 0.11085032671689987,
      "model/modality_embedder/grad_norm": 0.0487162321805954,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5237760416666667,
      "model/modality_embedder/update_ratio": 0.0015730884624645114,
      "model/modality_embedder/weight_delta": 3.1306557655334473,
      "model/modality_embedder/weight_delta_rel": 0.10228828340768814,
      "model/modality_embedder/weight_norm": 30.96852684020996,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.02079772949219,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.39324760027885,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.998085975646973,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.076058761946236,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07438628375530243,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0326911024749279,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001169821829535067,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6733763217926025,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09741944819688797,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.945369720458984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.45940399169922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.194633807915057,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.808080673217773,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.62677886652972,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07342306524515152,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03226779028773308,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001084784627892077,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.389266014099121,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11740682274103165,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.74580192565918,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.06417846679688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.80434228871729,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.14427661895752,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.73298560486525,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06946539878845215,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030528485774993896,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009938946459442377,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6682727336883545,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12317372858524323,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.71601676940918,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.8879623413086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.62937882078507,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.824504852294922,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.987167795963437,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07294978946447372,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.032059796154499054,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00032783247297629714,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010709811467677355,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1478185653686523,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10757750272750854,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.93497657775879,
      "model/normalizer/grad_frac": 0.2645682692527771,
      "model/normalizer/grad_norm": 0.11627182364463806,
      "model/normalizer/grad_zero_frac": 0.0002446198486723006,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014787197578698397,
      "model/normalizer/weight_delta": 6.631474018096924,
      "model/normalizer/weight_delta_rel": 0.08540954440832138,
      "model/normalizer/weight_norm": 78.63005828857422,
      "pose_mae_dtheta": 0.18727117776870728,
      "pose_mae_dx": 0.06531895697116852,
      "pose_mae_dy": 0.04790746048092842,
      "pose_rmse_dtheta": 0.322180837392807,
      "pose_rmse_dx": 0.18599143624305725,
      "pose_rmse_dy": 0.10578719526529312,
      "pose_rmse_mean": 0.20465317368507385,
      "rmse_dtheta": 0.03889851272106171,
      "rmse_dx": 0.019940374419093132,
      "rmse_dy": 0.006408186629414558,
      "rmse_mean": 0.021749025210738182,
      "rotation_flip": 0.015325670130550861,
      "sparse_tokens": 19000.0,
      "step": 8950,
      "turn_loss": 0.20148111879825592,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.41586136405872515,
      "grad_norm": 0.6127297878265381,
      "learning_rate": 1.5400476682302456e-06,
      "loss": 0.1183,
      "mae_dtheta": 0.010265816934406757,
      "mae_dx": 0.0012983025517314672,
      "mae_dy": 0.0015063887694850564,
      "pose_mae_dtheta": 0.07093460857868195,
      "pose_mae_dx": 0.014685338363051414,
      "pose_mae_dy": 0.01870415359735489,
      "pose_rmse_dtheta": 0.2556924521923065,
      "pose_rmse_dx": 0.03949206694960594,
      "pose_rmse_dy": 0.049941372126340866,
      "pose_rmse_mean": 0.11504196375608444,
      "rmse_dtheta": 0.028267940506339073,
      "rmse_dx": 0.003815033007413149,
      "rmse_dy": 0.003547340864315629,
      "rmse_mean": 0.011876772157847881,
      "rotation_flip": 0.005877413786947727,
      "sparse_tokens": 32121.0,
      "step": 8951,
      "turn_loss": 0.08082671463489532,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32766.0,
      "epoch": 0.4159078238245679,
      "grad_norm": 0.691484272480011,
      "learning_rate": 1.5390932704520345e-06,
      "loss": 0.198,
      "mae_dtheta": 0.030618518590927124,
      "mae_dx": 0.007135036867111921,
      "mae_dy": 0.005322564858943224,
      "pose_mae_dtheta": 0.21636728942394257,
      "pose_mae_dx": 0.056845709681510925,
      "pose_mae_dy": 0.06289003044366837,
      "pose_rmse_dtheta": 0.39503228664398193,
      "pose_rmse_dx": 0.1470470279455185,
      "pose_rmse_dy": 0.14416339993476868,
      "pose_rmse_mean": 0.22874757647514343,
      "rmse_dtheta": 0.04774133861064911,
      "rmse_dx": 0.017170408740639687,
      "rmse_dy": 0.01084006018936634,
      "rmse_mean": 0.025250602513551712,
      "rotation_flip": 0.013468013145029545,
      "sparse_tokens": 26388.0,
      "step": 8952,
      "turn_loss": 0.253660649061203,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.4159542835904107,
      "grad_norm": 0.6128414273262024,
      "learning_rate": 1.5381391146968866e-06,
      "loss": 0.1408,
      "mae_dtheta": 0.024824414402246475,
      "mae_dx": 0.01114981435239315,
      "mae_dy": 0.00434075016528368,
      "pose_mae_dtheta": 0.19521823525428772,
      "pose_mae_dx": 0.08771400153636932,
      "pose_mae_dy": 0.06219371035695076,
      "pose_rmse_dtheta": 0.4120360314846039,
      "pose_rmse_dx": 0.2244996279478073,
      "pose_rmse_dy": 0.15195055305957794,
      "pose_rmse_mean": 0.2628287374973297,
      "rmse_dtheta": 0.04494057968258858,
      "rmse_dx": 0.02561856247484684,
      "rmse_dy": 0.009087256155908108,
      "rmse_mean": 0.026548800989985466,
      "rotation_flip": 0.010204081423580647,
      "sparse_tokens": 13101.0,
      "step": 8953,
      "turn_loss": 0.14835913479328156,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.4160007433562535,
      "grad_norm": 0.4092801511287689,
      "learning_rate": 1.5371852010315302e-06,
      "loss": 0.119,
      "mae_dtheta": 0.0270038153976202,
      "mae_dx": 0.010434486903250217,
      "mae_dy": 0.004232172854244709,
      "pose_mae_dtheta": 0.22689636051654816,
      "pose_mae_dx": 0.07571304589509964,
      "pose_mae_dy": 0.058993060141801834,
      "pose_rmse_dtheta": 0.3932293951511383,
      "pose_rmse_dx": 0.20071452856063843,
      "pose_rmse_dy": 0.15379734337329865,
      "pose_rmse_mean": 0.24924710392951965,
      "rmse_dtheta": 0.04375381022691727,
      "rmse_dx": 0.02371598780155182,
      "rmse_dy": 0.008701845072209835,
      "rmse_mean": 0.02539054863154888,
      "rotation_flip": 0.011538461782038212,
      "sparse_tokens": 8424.0,
      "step": 8954,
      "turn_loss": 0.26984649896621704,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.41604720312209625,
      "grad_norm": 0.5825355052947998,
      "learning_rate": 1.5362315295226699e-06,
      "loss": 0.1475,
      "mae_dtheta": 0.007295967545360327,
      "mae_dx": 0.0017962040146812797,
      "mae_dy": 0.001238681492395699,
      "pose_mae_dtheta": 0.05353726074099541,
      "pose_mae_dx": 0.0186631940305233,
      "pose_mae_dy": 0.016750002279877663,
      "pose_rmse_dtheta": 0.1656297892332077,
      "pose_rmse_dx": 0.04974544793367386,
      "pose_rmse_dy": 0.03835931420326233,
      "pose_rmse_mean": 0.08457818627357483,
      "rmse_dtheta": 0.0190669447183609,
      "rmse_dx": 0.006044556852430105,
      "rmse_dy": 0.0026558844838291407,
      "rmse_mean": 0.009255795739591122,
      "rotation_flip": 0.00651658745482564,
      "sparse_tokens": 32073.0,
      "step": 8955,
      "turn_loss": 0.055677540600299835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.41609366288793903,
      "grad_norm": 0.35762250423431396,
      "learning_rate": 1.5352781002369976e-06,
      "loss": 0.0847,
      "mae_dtheta": 0.03145017847418785,
      "mae_dx": 0.012126779183745384,
      "mae_dy": 0.006520061753690243,
      "pose_mae_dtheta": 0.21446682512760162,
      "pose_mae_dx": 0.09311959892511368,
      "pose_mae_dy": 0.08542756736278534,
      "pose_rmse_dtheta": 0.3626776933670044,
      "pose_rmse_dx": 0.19695928692817688,
      "pose_rmse_dy": 0.1669987291097641,
      "pose_rmse_mean": 0.24221190810203552,
      "rmse_dtheta": 0.04414211958646774,
      "rmse_dx": 0.024331528693437576,
      "rmse_dy": 0.010781409218907356,
      "rmse_mean": 0.026418354362249374,
      "rotation_flip": 0.012035011313855648,
      "sparse_tokens": 14725.0,
      "step": 8956,
      "turn_loss": 0.2507721185684204,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4161401226537818,
      "grad_norm": 0.364704966545105,
      "learning_rate": 1.5343249132411892e-06,
      "loss": 0.0982,
      "mae_dtheta": 0.009820923209190369,
      "mae_dx": 0.0023688324727118015,
      "mae_dy": 0.00213631521910429,
      "pose_mae_dtheta": 0.06598031520843506,
      "pose_mae_dx": 0.017808876931667328,
      "pose_mae_dy": 0.020767249166965485,
      "pose_rmse_dtheta": 0.21080181002616882,
      "pose_rmse_dx": 0.05568275228142738,
      "pose_rmse_dy": 0.04910345748066902,
      "pose_rmse_mean": 0.105196014046669,
      "rmse_dtheta": 0.024930326268076897,
      "rmse_dx": 0.008846086449921131,
      "rmse_dy": 0.006581597495824099,
      "rmse_mean": 0.01345267053693533,
      "rotation_flip": 0.004446640145033598,
      "sparse_tokens": 32089.0,
      "step": 8957,
      "turn_loss": 0.0983070582151413,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.4161865824196246,
      "grad_norm": 0.7268166542053223,
      "learning_rate": 1.5333719686018978e-06,
      "loss": 0.1065,
      "mae_dtheta": 0.02418646588921547,
      "mae_dx": 0.007398069836199284,
      "mae_dy": 0.006978279445320368,
      "pose_mae_dtheta": 0.17446944117546082,
      "pose_mae_dx": 0.06903791427612305,
      "pose_mae_dy": 0.07147718966007233,
      "pose_rmse_dtheta": 0.285680890083313,
      "pose_rmse_dx": 0.14217841625213623,
      "pose_rmse_dy": 0.15869523584842682,
      "pose_rmse_mean": 0.19551818072795868,
      "rmse_dtheta": 0.03616805002093315,
      "rmse_dx": 0.0162910558283329,
      "rmse_dy": 0.013899527490139008,
      "rmse_mean": 0.022119544446468353,
      "rotation_flip": 0.006097560748457909,
      "sparse_tokens": 5762.0,
      "step": 8958,
      "turn_loss": 0.2844323217868805,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.41623304218546736,
      "grad_norm": 0.6585444808006287,
      "learning_rate": 1.5324192663857673e-06,
      "loss": 0.18,
      "mae_dtheta": 0.03337771072983742,
      "mae_dx": 0.011911221779882908,
      "mae_dy": 0.006521536037325859,
      "pose_mae_dtheta": 0.2466723769903183,
      "pose_mae_dx": 0.0998665913939476,
      "pose_mae_dy": 0.08071088045835495,
      "pose_rmse_dtheta": 0.42538920044898987,
      "pose_rmse_dx": 0.22649049758911133,
      "pose_rmse_dy": 0.164168119430542,
      "pose_rmse_mean": 0.27201592922210693,
      "rmse_dtheta": 0.0482867956161499,
      "rmse_dx": 0.024721240624785423,
      "rmse_dy": 0.012182459235191345,
      "rmse_mean": 0.028396833688020706,
      "rotation_flip": 0.01433691754937172,
      "sparse_tokens": 19519.0,
      "step": 8959,
      "turn_loss": 0.3230080008506775,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.41627950195131014,
      "grad_norm": 0.3406098186969757,
      "learning_rate": 1.5314668066594168e-06,
      "loss": 0.0724,
      "mae_dtheta": 0.008411135524511337,
      "mae_dx": 0.0010886812815442681,
      "mae_dy": 0.001170194474980235,
      "pose_mae_dtheta": 0.05858035013079643,
      "pose_mae_dx": 0.01021516416221857,
      "pose_mae_dy": 0.016618361696600914,
      "pose_rmse_dtheta": 0.19825994968414307,
      "pose_rmse_dx": 0.02796678990125656,
      "pose_rmse_dy": 0.03869367018342018,
      "pose_rmse_mean": 0.08830680698156357,
      "rmse_dtheta": 0.02376258559525013,
      "rmse_dx": 0.003773825243115425,
      "rmse_dy": 0.0027500875294208527,
      "rmse_mean": 0.010095499455928802,
      "rotation_flip": 0.003449762938544154,
      "sparse_tokens": 32121.0,
      "step": 8960,
      "turn_loss": 0.05294421687722206,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.41632596171715297,
      "grad_norm": 0.5250315070152283,
      "learning_rate": 1.5305145894894547e-06,
      "loss": 0.1087,
      "mae_dtheta": 0.03337184712290764,
      "mae_dx": 0.010424050502479076,
      "mae_dy": 0.005197086837142706,
      "pose_mae_dtheta": 0.22803515195846558,
      "pose_mae_dx": 0.09328189492225647,
      "pose_mae_dy": 0.05849962309002876,
      "pose_rmse_dtheta": 0.41159558296203613,
      "pose_rmse_dx": 0.19939793646335602,
      "pose_rmse_dy": 0.13473176956176758,
      "pose_rmse_mean": 0.2485750913619995,
      "rmse_dtheta": 0.05162583291530609,
      "rmse_dx": 0.0218213964253664,
      "rmse_dy": 0.010188949294388294,
      "rmse_mean": 0.02787872776389122,
      "rotation_flip": 0.012429378926753998,
      "sparse_tokens": 14811.0,
      "step": 8961,
      "turn_loss": 0.26533496379852295,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.41637242148299575,
      "grad_norm": 0.4331572949886322,
      "learning_rate": 1.5295626149424707e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.005896638613194227,
      "mae_dx": 0.0008207685896195471,
      "mae_dy": 0.0002276353188790381,
      "pose_mae_dtheta": 0.04260004311800003,
      "pose_mae_dx": 0.005619436502456665,
      "pose_mae_dy": 0.002513469895347953,
      "pose_rmse_dtheta": 0.23323282599449158,
      "pose_rmse_dx": 0.014912979677319527,
      "pose_rmse_dy": 0.006589289288967848,
      "pose_rmse_mean": 0.08491169661283493,
      "rmse_dtheta": 0.026411395519971848,
      "rmse_dx": 0.002784663112834096,
      "rmse_dy": 0.0003896828566212207,
      "rmse_mean": 0.009861914440989494,
      "rotation_flip": 0.0018198362085968256,
      "sparse_tokens": 32121.0,
      "step": 8962,
      "turn_loss": 0.03161109983921051,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4164188812488385,
      "grad_norm": 0.30070897936820984,
      "learning_rate": 1.5286108830850343e-06,
      "loss": 0.0707,
      "mae_dtheta": 0.005177860148251057,
      "mae_dx": 0.0013559914659708738,
      "mae_dy": 0.0002972351503558457,
      "pose_mae_dtheta": 0.03875851631164551,
      "pose_mae_dx": 0.009603416547179222,
      "pose_mae_dy": 0.003783239983022213,
      "pose_rmse_dtheta": 0.17497287690639496,
      "pose_rmse_dx": 0.0289272703230381,
      "pose_rmse_dy": 0.01066604908555746,
      "pose_rmse_mean": 0.0715220645070076,
      "rmse_dtheta": 0.022052636370062828,
      "rmse_dx": 0.004366832319647074,
      "rmse_dy": 0.00084683793829754,
      "rmse_mean": 0.009088769555091858,
      "rotation_flip": 0.0020429010037332773,
      "sparse_tokens": 32105.0,
      "step": 8963,
      "turn_loss": 0.03196928650140762,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4164653410146813,
      "grad_norm": 0.6855510473251343,
      "learning_rate": 1.5276593939837032e-06,
      "loss": 0.121,
      "mae_dtheta": 0.008914913982152939,
      "mae_dx": 0.0015642715152353048,
      "mae_dy": 0.0019144933903589845,
      "pose_mae_dtheta": 0.055515106767416,
      "pose_mae_dx": 0.01706872135400772,
      "pose_mae_dy": 0.024658087641000748,
      "pose_rmse_dtheta": 0.11575440317392349,
      "pose_rmse_dx": 0.04180026426911354,
      "pose_rmse_dy": 0.058959752321243286,
      "pose_rmse_mean": 0.07217147946357727,
      "rmse_dtheta": 0.018169334158301353,
      "rmse_dx": 0.004739663563668728,
      "rmse_dy": 0.004197316709905863,
      "rmse_mean": 0.009035438299179077,
      "rotation_flip": 0.005636070854961872,
      "sparse_tokens": 32121.0,
      "step": 8964,
      "turn_loss": 0.07678644359111786,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4165118007805241,
      "grad_norm": 0.6437761783599854,
      "learning_rate": 1.5267081477050132e-06,
      "loss": 0.1985,
      "mae_dtheta": 0.006586277857422829,
      "mae_dx": 0.001035665045492351,
      "mae_dy": 0.0008556360262446105,
      "pose_mae_dtheta": 0.043495409190654755,
      "pose_mae_dx": 0.01087893545627594,
      "pose_mae_dy": 0.014029999263584614,
      "pose_rmse_dtheta": 0.13485756516456604,
      "pose_rmse_dx": 0.03084217943251133,
      "pose_rmse_dy": 0.040645696222782135,
      "pose_rmse_mean": 0.06878181546926498,
      "rmse_dtheta": 0.02042214758694172,
      "rmse_dx": 0.0037912209518253803,
      "rmse_dy": 0.0021304304245859385,
      "rmse_mean": 0.008781266398727894,
      "rotation_flip": 0.001755412551574409,
      "sparse_tokens": 32105.0,
      "step": 8965,
      "turn_loss": 0.049042362719774246,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.41655826054636685,
      "grad_norm": 0.33313485980033875,
      "learning_rate": 1.5257571443154885e-06,
      "loss": 0.0758,
      "mae_dtheta": 0.009614521637558937,
      "mae_dx": 0.0016364535549655557,
      "mae_dy": 0.0023313425481319427,
      "pose_mae_dtheta": 0.056867487728595734,
      "pose_mae_dx": 0.022674692794680595,
      "pose_mae_dy": 0.028082937002182007,
      "pose_rmse_dtheta": 0.10664765536785126,
      "pose_rmse_dx": 0.05292557179927826,
      "pose_rmse_dy": 0.05574272945523262,
      "pose_rmse_mean": 0.07177198678255081,
      "rmse_dtheta": 0.018353505060076714,
      "rmse_dx": 0.004446587059646845,
      "rmse_dy": 0.004536204040050507,
      "rmse_mean": 0.009112099185585976,
      "rotation_flip": 0.0026325685903429985,
      "sparse_tokens": 32089.0,
      "step": 8966,
      "turn_loss": 0.08004430681467056,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.41660472031220963,
      "grad_norm": 0.639317512512207,
      "learning_rate": 1.5248063838816295e-06,
      "loss": 0.148,
      "mae_dtheta": 0.00870551634579897,
      "mae_dx": 0.003049062332138419,
      "mae_dy": 0.0026850185822695494,
      "pose_mae_dtheta": 0.06698437035083771,
      "pose_mae_dx": 0.023895418271422386,
      "pose_mae_dy": 0.01954173855483532,
      "pose_rmse_dtheta": 0.22257108986377716,
      "pose_rmse_dx": 0.07754634320735931,
      "pose_rmse_dy": 0.055639564990997314,
      "pose_rmse_mean": 0.11858566850423813,
      "rmse_dtheta": 0.02484387904405594,
      "rmse_dx": 0.01127395685762167,
      "rmse_dy": 0.010365601629018784,
      "rmse_mean": 0.015494479797780514,
      "rotation_flip": 0.0040241447277367115,
      "sparse_tokens": 32217.0,
      "step": 8967,
      "turn_loss": 0.09877362102270126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.4166511800780524,
      "grad_norm": 0.31088507175445557,
      "learning_rate": 1.5238558664699255e-06,
      "loss": 0.0807,
      "mae_dtheta": 0.0253268014639616,
      "mae_dx": 0.00882527232170105,
      "mae_dy": 0.0034003444015979767,
      "pose_mae_dtheta": 0.21997466683387756,
      "pose_mae_dx": 0.07510816305875778,
      "pose_mae_dy": 0.04578413441777229,
      "pose_rmse_dtheta": 0.4265352785587311,
      "pose_rmse_dx": 0.17952488362789154,
      "pose_rmse_dy": 0.12310779839754105,
      "pose_rmse_mean": 0.24305598437786102,
      "rmse_dtheta": 0.04429592564702034,
      "rmse_dx": 0.0188561100512743,
      "rmse_dy": 0.007386911194771528,
      "rmse_mean": 0.023512981832027435,
      "rotation_flip": 0.007731958758085966,
      "sparse_tokens": 13162.0,
      "step": 8968,
      "turn_loss": 0.20844899117946625,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.4166976398438952,
      "grad_norm": 0.39223164319992065,
      "learning_rate": 1.5229055921468478e-06,
      "loss": 0.0829,
      "mae_dtheta": 0.04213602468371391,
      "mae_dx": 0.013058309443295002,
      "mae_dy": 0.005928003694862127,
      "pose_mae_dtheta": 0.33057668805122375,
      "pose_mae_dx": 0.08850854635238647,
      "pose_mae_dy": 0.06925006210803986,
      "pose_rmse_dtheta": 0.5585716366767883,
      "pose_rmse_dx": 0.1797873079776764,
      "pose_rmse_dy": 0.15152201056480408,
      "pose_rmse_mean": 0.296627014875412,
      "rmse_dtheta": 0.0603313185274601,
      "rmse_dx": 0.024676231667399406,
      "rmse_dy": 0.011207767762243748,
      "rmse_mean": 0.03207177296280861,
      "rotation_flip": 0.016393441706895828,
      "sparse_tokens": 11207.0,
      "step": 8969,
      "turn_loss": 0.3075374364852905,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 33310.0,
      "epoch": 0.41674409960973796,
      "grad_norm": 0.45837244391441345,
      "learning_rate": 1.5219555609788467e-06,
      "loss": 0.1292,
      "mae_dtheta": 0.038953136652708054,
      "mae_dx": 0.012799834832549095,
      "mae_dy": 0.006020492874085903,
      "pose_mae_dtheta": 0.3306015729904175,
      "pose_mae_dx": 0.09636116772890091,
      "pose_mae_dy": 0.07618599385023117,
      "pose_rmse_dtheta": 0.5683651566505432,
      "pose_rmse_dx": 0.21628010272979736,
      "pose_rmse_dy": 0.20317667722702026,
      "pose_rmse_mean": 0.3292739987373352,
      "rmse_dtheta": 0.05737096443772316,
      "rmse_dx": 0.025618286803364754,
      "rmse_dy": 0.011785494163632393,
      "rmse_mean": 0.03159158304333687,
      "rotation_flip": 0.013027295470237732,
      "sparse_tokens": 26842.0,
      "step": 8970,
      "turn_loss": 0.29799360036849976,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.41679055937558074,
      "grad_norm": 0.7156845331192017,
      "learning_rate": 1.521005773032362e-06,
      "loss": 0.1247,
      "mae_dtheta": 0.007782917935401201,
      "mae_dx": 0.003546915017068386,
      "mae_dy": 0.0029648824129253626,
      "pose_mae_dtheta": 0.057353224605321884,
      "pose_mae_dx": 0.03786351531744003,
      "pose_mae_dy": 0.027518318966031075,
      "pose_rmse_dtheta": 0.15870538353919983,
      "pose_rmse_dx": 0.13608233630657196,
      "pose_rmse_dy": 0.07490891218185425,
      "pose_rmse_mean": 0.12323220819234848,
      "rmse_dtheta": 0.02054736018180847,
      "rmse_dx": 0.011952920816838741,
      "rmse_dy": 0.009151180274784565,
      "rmse_mean": 0.013883820734918118,
      "rotation_flip": 0.0027173913549631834,
      "sparse_tokens": 32057.0,
      "step": 8971,
      "turn_loss": 0.09077650308609009,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28227.0,
      "epoch": 0.4168370191414235,
      "grad_norm": 0.44820478558540344,
      "learning_rate": 1.520056228373809e-06,
      "loss": 0.1224,
      "mae_dtheta": 0.033610858023166656,
      "mae_dx": 0.010586689226329327,
      "mae_dy": 0.003986353985965252,
      "pose_mae_dtheta": 0.258169949054718,
      "pose_mae_dx": 0.08617381751537323,
      "pose_mae_dy": 0.04358285292983055,
      "pose_rmse_dtheta": 0.4617152810096741,
      "pose_rmse_dx": 0.18956038355827332,
      "pose_rmse_dy": 0.10311079770326614,
      "pose_rmse_mean": 0.2514621615409851,
      "rmse_dtheta": 0.05148644372820854,
      "rmse_dx": 0.021919865161180496,
      "rmse_dy": 0.007806523237377405,
      "rmse_mean": 0.027070945128798485,
      "rotation_flip": 0.011424219235777855,
      "sparse_tokens": 22270.0,
      "step": 8972,
      "turn_loss": 0.245309978723526,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4168834789072663,
      "grad_norm": 0.4561653435230255,
      "learning_rate": 1.5191069270695935e-06,
      "loss": 0.1353,
      "mae_dtheta": 0.01228879950940609,
      "mae_dx": 0.0019957199692726135,
      "mae_dy": 0.0029017720371484756,
      "pose_mae_dtheta": 0.06838787347078323,
      "pose_mae_dx": 0.024296797811985016,
      "pose_mae_dy": 0.030034635215997696,
      "pose_rmse_dtheta": 0.14797791838645935,
      "pose_rmse_dx": 0.05673174932599068,
      "pose_rmse_dy": 0.06878026574850082,
      "pose_rmse_mean": 0.09116330742835999,
      "rmse_dtheta": 0.022937921807169914,
      "rmse_dx": 0.005275847390294075,
      "rmse_dy": 0.005602282006293535,
      "rmse_mean": 0.011272016912698746,
      "rotation_flip": 0.014854827895760536,
      "sparse_tokens": 32137.0,
      "step": 8973,
      "turn_loss": 0.12999600172042847,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.41692993867310907,
      "grad_norm": 0.4741753041744232,
      "learning_rate": 1.5181578691860977e-06,
      "loss": 0.0948,
      "mae_dtheta": 0.030567681416869164,
      "mae_dx": 0.011309407651424408,
      "mae_dy": 0.003879173891618848,
      "pose_mae_dtheta": 0.2210027128458023,
      "pose_mae_dx": 0.07956134527921677,
      "pose_mae_dy": 0.0543212853372097,
      "pose_rmse_dtheta": 0.4425300061702728,
      "pose_rmse_dx": 0.20320865511894226,
      "pose_rmse_dy": 0.11542151123285294,
      "pose_rmse_mean": 0.25372007489204407,
      "rmse_dtheta": 0.04837969318032265,
      "rmse_dx": 0.02437412366271019,
      "rmse_dy": 0.006908866576850414,
      "rmse_mean": 0.026554226875305176,
      "rotation_flip": 0.018489984795451164,
      "sparse_tokens": 10053.0,
      "step": 8974,
      "turn_loss": 0.19703364372253418,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 36341.0,
      "epoch": 0.41697639843895185,
      "grad_norm": 0.5529664754867554,
      "learning_rate": 1.5172090547896917e-06,
      "loss": 0.1415,
      "mae_dtheta": 0.02675558254122734,
      "mae_dx": 0.009727728553116322,
      "mae_dy": 0.005427599418908358,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5529665946960449,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 154.7821502685547,
      "model/head/act_norm_mean": 110.25796072823661,
      "model/head/act_norm_min": 77.3320541381836,
      "model/head/act_over_embed": 75.77030286373592,
      "model/head/grad_frac": 0.08940634876489639,
      "model/head/grad_norm": 0.0494387224316597,
      "model/head/grad_zero_frac": 0.00021098573051858693,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6906302315848214,
      "model/head/update_ratio": 0.0008418955258093774,
      "model/head/weight_delta": 9.85442066192627,
      "model/head/weight_delta_rel": 0.17287573218345642,
      "model/head/weight_norm": 58.72311019897461,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42260119318962097,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42254378732326814,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4224969148635864,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2903760465658133,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1068609282374382,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05909052491188049,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.4931554203539823,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019080720376223326,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1327991485595703,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10235831141471863,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968708038330078,
      "model/modality_embedder/grad_frac": 0.1068609282374382,
      "model/modality_embedder/grad_norm": 0.05909052491188049,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.4931554203539823,
      "model/modality_embedder/update_ratio": 0.0019080720376223326,
      "model/modality_embedder/weight_delta": 3.1327991485595703,
      "model/modality_embedder/weight_delta_rel": 0.10235831141471863,
      "model/modality_embedder/weight_norm": 30.968708038330078,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.88676452636719,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.703213577097507,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.139727592468262,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.289070283163213,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06208684667944908,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.034331951290369034,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012285205302760005,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6749956607818604,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0974784567952156,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.945770263671875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.3150634765625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.531630881519273,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.63731861114502,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.85836641052685,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06385491788387299,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03530963510274887,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001187024055980146,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.391535997390747,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11748545616865158,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.746353149414062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.01273345947266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.18663858772676,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.126888275146484,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.995703200658895,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05994319170713425,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.033146582543849945,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010791124077513814,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6706204414367676,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12325256317853928,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.716524124145508,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.58934783935547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.036126169217688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.911436080932617,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.266688381835007,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.052930571138858795,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.029268838465213776,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009777344530448318,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1498799324035645,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10764794796705246,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.935365676879883,
      "model/normalizer/grad_frac": 0.2120177298784256,
      "model/normalizer/grad_norm": 0.11723872274160385,
      "model/normalizer/grad_zero_frac": 0.0002481650735717267,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014910052996128798,
      "model/normalizer/weight_delta": 6.635782241821289,
      "model/normalizer/weight_delta_rel": 0.08546503633260727,
      "model/normalizer/weight_norm": 78.63065338134766,
      "pose_mae_dtheta": 0.21017102897167206,
      "pose_mae_dx": 0.0735098123550415,
      "pose_mae_dy": 0.0609835609793663,
      "pose_rmse_dtheta": 0.43595418334007263,
      "pose_rmse_dx": 0.17794139683246613,
      "pose_rmse_dy": 0.14966046810150146,
      "pose_rmse_mean": 0.25451868772506714,
      "rmse_dtheta": 0.04647903889417648,
      "rmse_dx": 0.021975640207529068,
      "rmse_dy": 0.011989114806056023,
      "rmse_mean": 0.026814600452780724,
      "rotation_flip": 0.01011378038674593,
      "sparse_tokens": 28834.0,
      "step": 8975,
      "turn_loss": 0.2121211141347885,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4170228582047946,
      "grad_norm": 0.4176231026649475,
      "learning_rate": 1.5162604839467265e-06,
      "loss": 0.0875,
      "mae_dtheta": 0.0090669309720397,
      "mae_dx": 0.0014252287801355124,
      "mae_dy": 0.0020486919675022364,
      "pose_mae_dtheta": 0.061191070824861526,
      "pose_mae_dx": 0.019412966445088387,
      "pose_mae_dy": 0.026165299117565155,
      "pose_rmse_dtheta": 0.1786614954471588,
      "pose_rmse_dx": 0.06686615198850632,
      "pose_rmse_dy": 0.0665130689740181,
      "pose_rmse_mean": 0.10401357710361481,
      "rmse_dtheta": 0.021233201026916504,
      "rmse_dx": 0.004831142723560333,
      "rmse_dy": 0.005405381787568331,
      "rmse_mean": 0.01048990897834301,
      "rotation_flip": 0.00297745643183589,
      "sparse_tokens": 32089.0,
      "step": 8976,
      "turn_loss": 0.07327516376972198,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.41706931797063745,
      "grad_norm": 0.986994743347168,
      "learning_rate": 1.5153121567235334e-06,
      "loss": 0.271,
      "mae_dtheta": 0.04767630994319916,
      "mae_dx": 0.013320599682629108,
      "mae_dy": 0.005056856200098991,
      "pose_mae_dtheta": 0.4199380576610565,
      "pose_mae_dx": 0.12071972340345383,
      "pose_mae_dy": 0.05793045088648796,
      "pose_rmse_dtheta": 0.6861280202865601,
      "pose_rmse_dx": 0.2666779160499573,
      "pose_rmse_dy": 0.13320831954479218,
      "pose_rmse_mean": 0.36200475692749023,
      "rmse_dtheta": 0.0677226334810257,
      "rmse_dx": 0.026766208931803703,
      "rmse_dy": 0.009730189107358456,
      "rmse_mean": 0.03473968058824539,
      "rotation_flip": 0.010676156729459763,
      "sparse_tokens": 15136.0,
      "step": 8977,
      "turn_loss": 0.3106818199157715,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.41711577773648023,
      "grad_norm": 0.6817866563796997,
      "learning_rate": 1.5143640731864335e-06,
      "loss": 0.1427,
      "mae_dtheta": 0.02628953568637371,
      "mae_dx": 0.011778149753808975,
      "mae_dy": 0.0036839046515524387,
      "pose_mae_dtheta": 0.20114938914775848,
      "pose_mae_dx": 0.09896574914455414,
      "pose_mae_dy": 0.045953359454870224,
      "pose_rmse_dtheta": 0.3968389630317688,
      "pose_rmse_dx": 0.24642688035964966,
      "pose_rmse_dy": 0.10910293459892273,
      "pose_rmse_mean": 0.250789612531662,
      "rmse_dtheta": 0.04318629950284958,
      "rmse_dx": 0.025939149782061577,
      "rmse_dy": 0.006868565455079079,
      "rmse_mean": 0.025331338867545128,
      "rotation_flip": 0.00542005430907011,
      "sparse_tokens": 23867.0,
      "step": 8978,
      "turn_loss": 0.20302022993564606,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.417162237502323,
      "grad_norm": 0.4325390160083771,
      "learning_rate": 1.5134162334017233e-06,
      "loss": 0.0931,
      "mae_dtheta": 0.030029352754354477,
      "mae_dx": 0.0033090999349951744,
      "mae_dy": 0.004113671835511923,
      "pose_mae_dtheta": 0.18907122313976288,
      "pose_mae_dx": 0.03422766178846359,
      "pose_mae_dy": 0.0568377822637558,
      "pose_rmse_dtheta": 0.4033898115158081,
      "pose_rmse_dx": 0.08120495080947876,
      "pose_rmse_dy": 0.11284253746271133,
      "pose_rmse_mean": 0.19914577901363373,
      "rmse_dtheta": 0.047731272876262665,
      "rmse_dx": 0.009611550718545914,
      "rmse_dy": 0.007415709551423788,
      "rmse_mean": 0.021586177870631218,
      "rotation_flip": 0.0027322403620928526,
      "sparse_tokens": 5739.0,
      "step": 8979,
      "turn_loss": 0.16921040415763855,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.4172086972681658,
      "grad_norm": 0.4943956136703491,
      "learning_rate": 1.5124686374356883e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.02975584752857685,
      "mae_dx": 0.012226147577166557,
      "mae_dy": 0.005935804918408394,
      "pose_mae_dtheta": 0.20532211661338806,
      "pose_mae_dx": 0.10410170257091522,
      "pose_mae_dy": 0.07183287292718887,
      "pose_rmse_dtheta": 0.357034832239151,
      "pose_rmse_dx": 0.2381478101015091,
      "pose_rmse_dy": 0.1496017426252365,
      "pose_rmse_mean": 0.2482614815235138,
      "rmse_dtheta": 0.04453572258353233,
      "rmse_dx": 0.02543206699192524,
      "rmse_dy": 0.010396233759820461,
      "rmse_mean": 0.026788009330630302,
      "rotation_flip": 0.010968921706080437,
      "sparse_tokens": 8888.0,
      "step": 8980,
      "turn_loss": 0.217201367020607,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.41725515703400856,
      "grad_norm": 0.7479323148727417,
      "learning_rate": 1.5115212853545924e-06,
      "loss": 0.1822,
      "mae_dtheta": 0.04574113339185715,
      "mae_dx": 0.012025033123791218,
      "mae_dy": 0.004700674209743738,
      "pose_mae_dtheta": 0.36687135696411133,
      "pose_mae_dx": 0.08335332572460175,
      "pose_mae_dy": 0.028581922873854637,
      "pose_rmse_dtheta": 0.6414244771003723,
      "pose_rmse_dx": 0.1718154102563858,
      "pose_rmse_dy": 0.07207493484020233,
      "pose_rmse_mean": 0.2951049506664276,
      "rmse_dtheta": 0.06389584392309189,
      "rmse_dx": 0.022972024977207184,
      "rmse_dy": 0.008979395031929016,
      "rmse_mean": 0.03194908797740936,
      "rotation_flip": 0.009216589853167534,
      "sparse_tokens": 3373.0,
      "step": 8981,
      "turn_loss": 0.4368950128555298,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.41730161679985134,
      "grad_norm": 0.5140194296836853,
      "learning_rate": 1.510574177224685e-06,
      "loss": 0.0685,
      "mae_dtheta": 0.003422954585403204,
      "mae_dx": 0.0017922729020938277,
      "mae_dy": 0.000267902942141518,
      "pose_mae_dtheta": 0.023719914257526398,
      "pose_mae_dx": 0.012228187173604965,
      "pose_mae_dy": 0.004264439921826124,
      "pose_rmse_dtheta": 0.11852244287729263,
      "pose_rmse_dx": 0.0561433769762516,
      "pose_rmse_dy": 0.01113672461360693,
      "pose_rmse_mean": 0.06193418428301811,
      "rmse_dtheta": 0.015269343741238117,
      "rmse_dx": 0.007616841234266758,
      "rmse_dy": 0.0006155575974844396,
      "rmse_mean": 0.007833914831280708,
      "rotation_flip": 0.0018867924809455872,
      "sparse_tokens": 32041.0,
      "step": 8982,
      "turn_loss": 0.024511804804205894,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4173480765656941,
      "grad_norm": 0.46986818313598633,
      "learning_rate": 1.5096273131121997e-06,
      "loss": 0.0594,
      "mae_dtheta": 0.006288623902946711,
      "mae_dx": 0.001064159907400608,
      "mae_dy": 0.0010927229886874557,
      "pose_mae_dtheta": 0.04716595634818077,
      "pose_mae_dx": 0.01294984295964241,
      "pose_mae_dy": 0.015358575619757175,
      "pose_rmse_dtheta": 0.147773876786232,
      "pose_rmse_dx": 0.033632490783929825,
      "pose_rmse_dy": 0.03731255233287811,
      "pose_rmse_mean": 0.07290630787611008,
      "rmse_dtheta": 0.017722852528095245,
      "rmse_dx": 0.003661390161141753,
      "rmse_dy": 0.0026048026047647,
      "rmse_mean": 0.007996348664164543,
      "rotation_flip": 0.004969629924744368,
      "sparse_tokens": 32089.0,
      "step": 8983,
      "turn_loss": 0.04346128925681114,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.4173945363315369,
      "grad_norm": 0.4630330801010132,
      "learning_rate": 1.5086806930833487e-06,
      "loss": 0.0933,
      "mae_dtheta": 0.051612477749586105,
      "mae_dx": 0.018790798261761665,
      "mae_dy": 0.004533322528004646,
      "pose_mae_dtheta": 0.4411669075489044,
      "pose_mae_dx": 0.15934473276138306,
      "pose_mae_dy": 0.06633920222520828,
      "pose_rmse_dtheta": 0.6817082762718201,
      "pose_rmse_dx": 0.29912441968917847,
      "pose_rmse_dy": 0.1336040198802948,
      "pose_rmse_mean": 0.3714789152145386,
      "rmse_dtheta": 0.06722395867109299,
      "rmse_dx": 0.03317270055413246,
      "rmse_dy": 0.007155197206884623,
      "rmse_mean": 0.03585062175989151,
      "rotation_flip": 0.017045455053448677,
      "sparse_tokens": 3087.0,
      "step": 8984,
      "turn_loss": 0.24735723435878754,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 32438.0,
      "epoch": 0.41744099609737967,
      "grad_norm": 0.5597715973854065,
      "learning_rate": 1.507734317204332e-06,
      "loss": 0.1584,
      "mae_dtheta": 0.030363211408257484,
      "mae_dx": 0.0076737431809306145,
      "mae_dy": 0.005037265829741955,
      "pose_mae_dtheta": 0.22762173414230347,
      "pose_mae_dx": 0.06923104077577591,
      "pose_mae_dy": 0.04071192070841789,
      "pose_rmse_dtheta": 0.45310094952583313,
      "pose_rmse_dx": 0.1727961152791977,
      "pose_rmse_dy": 0.09598459303379059,
      "pose_rmse_mean": 0.2406272143125534,
      "rmse_dtheta": 0.05110730230808258,
      "rmse_dx": 0.017480194568634033,
      "rmse_dy": 0.012296412140130997,
      "rmse_mean": 0.026961302384734154,
      "rotation_flip": 0.0093147037550807,
      "sparse_tokens": 25714.0,
      "step": 8985,
      "turn_loss": 0.2151903510093689,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.41748745586322245,
      "grad_norm": 0.4292680323123932,
      "learning_rate": 1.5067881855413275e-06,
      "loss": 0.1037,
      "mae_dtheta": 0.024564918130636215,
      "mae_dx": 0.009867929853498936,
      "mae_dy": 0.003545035608112812,
      "pose_mae_dtheta": 0.1905132532119751,
      "pose_mae_dx": 0.07823670655488968,
      "pose_mae_dy": 0.04865293204784393,
      "pose_rmse_dtheta": 0.35801923274993896,
      "pose_rmse_dx": 0.18611353635787964,
      "pose_rmse_dy": 0.11363372951745987,
      "pose_rmse_mean": 0.2192555069923401,
      "rmse_dtheta": 0.03997714817523956,
      "rmse_dx": 0.02159324660897255,
      "rmse_dy": 0.00814609695225954,
      "rmse_mean": 0.023238830268383026,
      "rotation_flip": 0.009560229256749153,
      "sparse_tokens": 9534.0,
      "step": 8986,
      "turn_loss": 0.2517702281475067,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4175339156290652,
      "grad_norm": 0.4163249731063843,
      "learning_rate": 1.5058422981604998e-06,
      "loss": 0.085,
      "mae_dtheta": 0.009029841050505638,
      "mae_dx": 0.0010949511779472232,
      "mae_dy": 0.0016566870035603642,
      "pose_mae_dtheta": 0.05528058856725693,
      "pose_mae_dx": 0.014068279415369034,
      "pose_mae_dy": 0.021013226360082626,
      "pose_rmse_dtheta": 0.15716440975666046,
      "pose_rmse_dx": 0.04319124296307564,
      "pose_rmse_dy": 0.05255085229873657,
      "pose_rmse_mean": 0.08430217206478119,
      "rmse_dtheta": 0.023213649168610573,
      "rmse_dx": 0.0034374885726720095,
      "rmse_dy": 0.004192631226032972,
      "rmse_mean": 0.010281257331371307,
      "rotation_flip": 0.00636363634839654,
      "sparse_tokens": 32089.0,
      "step": 8987,
      "turn_loss": 0.06041296571493149,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.417580375394908,
      "grad_norm": 0.5198478698730469,
      "learning_rate": 1.5048966551279975e-06,
      "loss": 0.1332,
      "mae_dtheta": 0.008976778946816921,
      "mae_dx": 0.0022140394430607557,
      "mae_dy": 0.0019336758414283395,
      "pose_mae_dtheta": 0.05945174768567085,
      "pose_mae_dx": 0.02398007921874523,
      "pose_mae_dy": 0.024374566972255707,
      "pose_rmse_dtheta": 0.15819279849529266,
      "pose_rmse_dx": 0.06626296043395996,
      "pose_rmse_dy": 0.06871113926172256,
      "pose_rmse_mean": 0.09772230684757233,
      "rmse_dtheta": 0.021729622036218643,
      "rmse_dx": 0.007627444341778755,
      "rmse_dy": 0.00481270719319582,
      "rmse_mean": 0.01138992514461279,
      "rotation_flip": 0.006382978521287441,
      "sparse_tokens": 32089.0,
      "step": 8988,
      "turn_loss": 0.09075473248958588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4176268351607508,
      "grad_norm": 0.5822756886482239,
      "learning_rate": 1.5039512565099468e-06,
      "loss": 0.1007,
      "mae_dtheta": 0.005804181564599276,
      "mae_dx": 0.000845333852339536,
      "mae_dy": 0.0005431640893220901,
      "pose_mae_dtheta": 0.039436012506484985,
      "pose_mae_dx": 0.007232840172946453,
      "pose_mae_dy": 0.007096812594681978,
      "pose_rmse_dtheta": 0.18938863277435303,
      "pose_rmse_dx": 0.016846265643835068,
      "pose_rmse_dy": 0.020592419430613518,
      "pose_rmse_mean": 0.07560911029577255,
      "rmse_dtheta": 0.023404492065310478,
      "rmse_dx": 0.0025761774741113186,
      "rmse_dy": 0.0014406325062736869,
      "rmse_mean": 0.009140434674918652,
      "rotation_flip": 0.0028409091755747795,
      "sparse_tokens": 32153.0,
      "step": 8989,
      "turn_loss": 0.032333750277757645,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.41767329492659355,
      "grad_norm": 0.5723283886909485,
      "learning_rate": 1.5030061023724624e-06,
      "loss": 0.0702,
      "mae_dtheta": 0.009332533925771713,
      "mae_dx": 0.0019970424473285675,
      "mae_dy": 0.0021368153393268585,
      "pose_mae_dtheta": 0.058329664170742035,
      "pose_mae_dx": 0.02376244217157364,
      "pose_mae_dy": 0.02220889739692211,
      "pose_rmse_dtheta": 0.14857396483421326,
      "pose_rmse_dx": 0.07058054953813553,
      "pose_rmse_dy": 0.055113017559051514,
      "pose_rmse_mean": 0.09142251312732697,
      "rmse_dtheta": 0.019985007122159004,
      "rmse_dx": 0.007508492562919855,
      "rmse_dy": 0.005199968349188566,
      "rmse_mean": 0.010897822678089142,
      "rotation_flip": 0.004866180010139942,
      "sparse_tokens": 32121.0,
      "step": 8990,
      "turn_loss": 0.06929519027471542,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.41771975469243633,
      "grad_norm": 0.520683765411377,
      "learning_rate": 1.5020611927816365e-06,
      "loss": 0.138,
      "mae_dtheta": 0.00690118782222271,
      "mae_dx": 0.0033258716575801373,
      "mae_dy": 0.0008622215827926993,
      "pose_mae_dtheta": 0.04683788865804672,
      "pose_mae_dx": 0.02972233109176159,
      "pose_mae_dy": 0.011930898763239384,
      "pose_rmse_dtheta": 0.18598024547100067,
      "pose_rmse_dx": 0.07905212044715881,
      "pose_rmse_dy": 0.03991826996207237,
      "pose_rmse_mean": 0.10165020823478699,
      "rmse_dtheta": 0.023239925503730774,
      "rmse_dx": 0.009877802804112434,
      "rmse_dy": 0.002188306301832199,
      "rmse_mean": 0.011768678203225136,
      "rotation_flip": 0.001953125,
      "sparse_tokens": 32185.0,
      "step": 8991,
      "turn_loss": 0.11644081771373749,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4177662144582791,
      "grad_norm": 0.4374527931213379,
      "learning_rate": 1.5011165278035505e-06,
      "loss": 0.0849,
      "mae_dtheta": 0.014329547062516212,
      "mae_dx": 0.0022598227951675653,
      "mae_dy": 0.0033779353834688663,
      "pose_mae_dtheta": 0.1017477959394455,
      "pose_mae_dx": 0.029538560658693314,
      "pose_mae_dy": 0.041175756603479385,
      "pose_rmse_dtheta": 0.2439134567975998,
      "pose_rmse_dx": 0.07004918158054352,
      "pose_rmse_dy": 0.10614059865474701,
      "pose_rmse_mean": 0.14003442227840424,
      "rmse_dtheta": 0.030850017443299294,
      "rmse_dx": 0.006343359127640724,
      "rmse_dy": 0.006819651462137699,
      "rmse_mean": 0.01467100903391838,
      "rotation_flip": 0.003931379411369562,
      "sparse_tokens": 32105.0,
      "step": 8992,
      "turn_loss": 0.14033369719982147,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25233.0,
      "epoch": 0.4178126742241219,
      "grad_norm": 0.5474587678909302,
      "learning_rate": 1.500172107504262e-06,
      "loss": 0.2075,
      "mae_dtheta": 0.03167218342423439,
      "mae_dx": 0.011897440068423748,
      "mae_dy": 0.00867937970906496,
      "pose_mae_dtheta": 0.24905803799629211,
      "pose_mae_dx": 0.09504599124193192,
      "pose_mae_dy": 0.08990725129842758,
      "pose_rmse_dtheta": 0.4408586621284485,
      "pose_rmse_dx": 0.19869118928909302,
      "pose_rmse_dy": 0.2170787900686264,
      "pose_rmse_mean": 0.28554290533065796,
      "rmse_dtheta": 0.04945463314652443,
      "rmse_dx": 0.023030562326312065,
      "rmse_dy": 0.018878988921642303,
      "rmse_mean": 0.03045472875237465,
      "rotation_flip": 0.018488746136426926,
      "sparse_tokens": 19825.0,
      "step": 8993,
      "turn_loss": 0.31213271617889404,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.4178591339899647,
      "grad_norm": 0.4886813461780548,
      "learning_rate": 1.4992279319498166e-06,
      "loss": 0.149,
      "mae_dtheta": 0.03271760791540146,
      "mae_dx": 0.007228766568005085,
      "mae_dy": 0.003980359993875027,
      "pose_mae_dtheta": 0.24596235156059265,
      "pose_mae_dx": 0.06794360280036926,
      "pose_mae_dy": 0.048456281423568726,
      "pose_rmse_dtheta": 0.45184382796287537,
      "pose_rmse_dx": 0.1443367600440979,
      "pose_rmse_dy": 0.09526608884334564,
      "pose_rmse_mean": 0.23048222064971924,
      "rmse_dtheta": 0.053501587361097336,
      "rmse_dx": 0.016600416973233223,
      "rmse_dy": 0.0075268433429300785,
      "rmse_mean": 0.025876283645629883,
      "rotation_flip": 0.014790467917919159,
      "sparse_tokens": 20768.0,
      "step": 8994,
      "turn_loss": 0.24129144847393036,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4179055937558075,
      "grad_norm": 0.48702841997146606,
      "learning_rate": 1.4982840012062428e-06,
      "loss": 0.1321,
      "mae_dtheta": 0.01007172279059887,
      "mae_dx": 0.0017351445276290178,
      "mae_dy": 0.002247423166409135,
      "pose_mae_dtheta": 0.06883233040571213,
      "pose_mae_dx": 0.02109975926578045,
      "pose_mae_dy": 0.021763158962130547,
      "pose_rmse_dtheta": 0.17887456715106964,
      "pose_rmse_dx": 0.049221694469451904,
      "pose_rmse_dy": 0.04762516915798187,
      "pose_rmse_mean": 0.09190714359283447,
      "rmse_dtheta": 0.023952390998601913,
      "rmse_dx": 0.004489792510867119,
      "rmse_dy": 0.004993156064301729,
      "rmse_mean": 0.011145113967359066,
      "rotation_flip": 0.003239740850403905,
      "sparse_tokens": 32185.0,
      "step": 8995,
      "turn_loss": 0.07570257037878036,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27902.0,
      "epoch": 0.41795205352165027,
      "grad_norm": 0.43114620447158813,
      "learning_rate": 1.4973403153395461e-06,
      "loss": 0.0887,
      "mae_dtheta": 0.02416594885289669,
      "mae_dx": 0.010568449273705482,
      "mae_dy": 0.0033764736726880074,
      "pose_mae_dtheta": 0.18692736327648163,
      "pose_mae_dx": 0.08713537454605103,
      "pose_mae_dy": 0.04499758034944534,
      "pose_rmse_dtheta": 0.3603290319442749,
      "pose_rmse_dx": 0.2176973670721054,
      "pose_rmse_dy": 0.10962436348199844,
      "pose_rmse_mean": 0.22921693325042725,
      "rmse_dtheta": 0.041237518191337585,
      "rmse_dx": 0.02322864532470703,
      "rmse_dy": 0.00679800845682621,
      "rmse_mean": 0.023754723370075226,
      "rotation_flip": 0.013257576152682304,
      "sparse_tokens": 21232.0,
      "step": 8996,
      "turn_loss": 0.16019561886787415,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.41799851328749305,
      "grad_norm": 0.34259605407714844,
      "learning_rate": 1.4963968744157232e-06,
      "loss": 0.0715,
      "mae_dtheta": 0.006927206180989742,
      "mae_dx": 0.0010887965327128768,
      "mae_dy": 0.00022719361004419625,
      "pose_mae_dtheta": 0.04708082973957062,
      "pose_mae_dx": 0.008396090939640999,
      "pose_mae_dy": 0.0028667317237704992,
      "pose_rmse_dtheta": 0.22182993590831757,
      "pose_rmse_dx": 0.01944764330983162,
      "pose_rmse_dy": 0.006922850850969553,
      "pose_rmse_mean": 0.08273348212242126,
      "rmse_dtheta": 0.028139282017946243,
      "rmse_dx": 0.0031390392687171698,
      "rmse_dy": 0.0005842592800036073,
      "rmse_mean": 0.010620860382914543,
      "rotation_flip": 0.0006648935959674418,
      "sparse_tokens": 32185.0,
      "step": 8997,
      "turn_loss": 0.042141374200582504,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.4180449730533358,
      "grad_norm": 0.8537636995315552,
      "learning_rate": 1.4954536785007456e-06,
      "loss": 0.2448,
      "mae_dtheta": 0.030691124498844147,
      "mae_dx": 0.004312522709369659,
      "mae_dy": 0.0016480997437611222,
      "pose_mae_dtheta": 0.2616276741027832,
      "pose_mae_dx": 0.036877233535051346,
      "pose_mae_dy": 0.02519785240292549,
      "pose_rmse_dtheta": 0.5586928725242615,
      "pose_rmse_dx": 0.10997957736253738,
      "pose_rmse_dy": 0.0650569498538971,
      "pose_rmse_mean": 0.24457645416259766,
      "rmse_dtheta": 0.05568530410528183,
      "rmse_dx": 0.01261124573647976,
      "rmse_dy": 0.0034538519103080034,
      "rmse_mean": 0.023916801437735558,
      "rotation_flip": 0.021978022530674934,
      "sparse_tokens": 5793.0,
      "step": 8998,
      "turn_loss": 0.11112856864929199,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 27173.0,
      "epoch": 0.4180914328191786,
      "grad_norm": 0.4633397161960602,
      "learning_rate": 1.4945107276605746e-06,
      "loss": 0.1517,
      "mae_dtheta": 0.03451181575655937,
      "mae_dx": 0.011947153136134148,
      "mae_dy": 0.006139324512332678,
      "pose_mae_dtheta": 0.2651035487651825,
      "pose_mae_dx": 0.09602628648281097,
      "pose_mae_dy": 0.08026793599128723,
      "pose_rmse_dtheta": 0.460999459028244,
      "pose_rmse_dx": 0.210431307554245,
      "pose_rmse_dy": 0.2136998027563095,
      "pose_rmse_mean": 0.2950435280799866,
      "rmse_dtheta": 0.05283408612012863,
      "rmse_dx": 0.024124469608068466,
      "rmse_dy": 0.014544753357768059,
      "rmse_mean": 0.030501103028655052,
      "rotation_flip": 0.016640253365039825,
      "sparse_tokens": 21157.0,
      "step": 8999,
      "turn_loss": 0.2541550099849701,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4181378925850214,
      "grad_norm": 0.6642246246337891,
      "learning_rate": 1.4935680219611487e-06,
      "loss": 0.1032,
      "mae_dtheta": 0.006830941420048475,
      "mae_dx": 0.0013190744211897254,
      "mae_dy": 0.0016019578324630857,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6642245650291443,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 164.17672729492188,
      "model/head/act_norm_mean": 110.19707820391415,
      "model/head/act_norm_min": 69.03594207763672,
      "model/head/act_over_embed": 75.72846382303035,
      "model/head/grad_frac": 0.08527746051549911,
      "model/head/grad_norm": 0.05664338544011116,
      "model/head/grad_zero_frac": 0.0001881421630969271,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6962791982323232,
      "model/head/update_ratio": 0.0009645736427046359,
      "model/head/weight_delta": 9.857970237731934,
      "model/head/weight_delta_rel": 0.1729380041360855,
      "model/head/weight_norm": 58.7237548828125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42268842458724976,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42258771531125333,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42252060770988464,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.290406234290417,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10160300135612488,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0674872100353241,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5546708776595745,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0021791900508105755,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1338400840759277,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10239232331514359,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968942642211914,
      "model/modality_embedder/grad_frac": 0.10160300135612488,
      "model/modality_embedder/grad_norm": 0.0674872100353241,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5546708776595745,
      "model/modality_embedder/update_ratio": 0.0021791900508105755,
      "model/modality_embedder/weight_delta": 3.1338400840759277,
      "model/modality_embedder/weight_delta_rel": 0.10239232331514359,
      "model/modality_embedder/weight_norm": 30.968942642211914,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.07109069824219,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.706900352733687,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.067862510681152,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.29160386989653,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0838351622223854,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0556853748857975,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019925760570913553,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6767423152923584,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09754210710525513,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.946422576904297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.5317611694336,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.73382385361552,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.332242012023926,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.997315313911816,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07993616163730621,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.053095560520887375,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001784896943718195,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3936729431152344,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11755948513746262,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.747129440307617,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 87.8143539428711,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.649633738175403,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.51943302154541,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.313877802676096,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0783628597855568,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05205053463578224,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016944967210292816,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6730849742889404,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12333531677722931,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.71739959716797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.65255737304688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.351180455347123,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.880305290222168,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.48319663684785,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07712661474943161,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05122939124703407,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017113123321905732,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.151886224746704,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10771651566028595,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.935733795166016,
      "model/normalizer/grad_frac": 0.32324081659317017,
      "model/normalizer/grad_norm": 0.2147044837474823,
      "model/normalizer/grad_zero_frac": 0.00019380509911570698,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00273051462136209,
      "model/normalizer/weight_delta": 6.640076160430908,
      "model/normalizer/weight_delta_rel": 0.08552033454179764,
      "model/normalizer/weight_norm": 78.63150787353516,
      "pose_mae_dtheta": 0.044790953397750854,
      "pose_mae_dx": 0.013802163302898407,
      "pose_mae_dy": 0.015966320410370827,
      "pose_rmse_dtheta": 0.10251536220312119,
      "pose_rmse_dx": 0.03556753695011139,
      "pose_rmse_dy": 0.04115978255867958,
      "pose_rmse_mean": 0.05974755808711052,
      "rmse_dtheta": 0.01616804674267769,
      "rmse_dx": 0.0036832503974437714,
      "rmse_dy": 0.003895893692970276,
      "rmse_mean": 0.007915730588138103,
      "rotation_flip": 0.007178750820457935,
      "sparse_tokens": 32201.0,
      "step": 9000,
      "turn_loss": 0.05665046349167824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.4181378925850214,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30081185698509216,
      "eval_objectnav_nopose_mae_dtheta": 0.03970785066485405,
      "eval_objectnav_nopose_mae_dx": 0.013216397725045681,
      "eval_objectnav_nopose_mae_dy": 0.005047393497079611,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31942740082740784,
      "eval_objectnav_nopose_pose_mae_dx": 0.10501548647880554,
      "eval_objectnav_nopose_pose_mae_dy": 0.055906329303979874,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5395538210868835,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22779430449008942,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13252680003643036,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29995831847190857,
      "eval_objectnav_nopose_rmse_dtheta": 0.05762484669685364,
      "eval_objectnav_nopose_rmse_dx": 0.025727389380335808,
      "eval_objectnav_nopose_rmse_dy": 0.010387546382844448,
      "eval_objectnav_nopose_rmse_mean": 0.031246595084667206,
      "eval_objectnav_nopose_rotation_flip": 0.016686083748936653,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30081185698509216,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 9000
    },
    {
      "epoch": 0.4181378925850214,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2717097997665405,
      "eval_objectnav_pose_mae_dtheta": 0.03500090911984444,
      "eval_objectnav_pose_mae_dx": 0.01123199425637722,
      "eval_objectnav_pose_mae_dy": 0.0046843113377690315,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26161983609199524,
      "eval_objectnav_pose_pose_mae_dx": 0.08787408471107483,
      "eval_objectnav_pose_pose_mae_dy": 0.04808947071433067,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4609721899032593,
      "eval_objectnav_pose_pose_rmse_dx": 0.2020343393087387,
      "eval_objectnav_pose_pose_rmse_dy": 0.11439962685108185,
      "eval_objectnav_pose_pose_rmse_mean": 0.2591353952884674,
      "eval_objectnav_pose_rmse_dtheta": 0.052789267152547836,
      "eval_objectnav_pose_rmse_dx": 0.023241324350237846,
      "eval_objectnav_pose_rmse_dy": 0.009653078392148018,
      "eval_objectnav_pose_rmse_mean": 0.028561223298311234,
      "eval_objectnav_pose_rotation_flip": 0.015713978558778763,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2717097997665405,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 9000
    },
    {
      "epoch": 0.4181378925850214,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08917610347270966,
      "eval_pointnav_mae_dtheta": 0.010438154451549053,
      "eval_pointnav_mae_dx": 0.002294652396813035,
      "eval_pointnav_mae_dy": 0.002375261625275016,
      "eval_pointnav_pose_mae_dtheta": 0.07185567915439606,
      "eval_pointnav_pose_mae_dx": 0.025718150660395622,
      "eval_pointnav_pose_mae_dy": 0.024835871532559395,
      "eval_pointnav_pose_rmse_dtheta": 0.20806455612182617,
      "eval_pointnav_pose_rmse_dx": 0.07963652163743973,
      "eval_pointnav_pose_rmse_dy": 0.07171500474214554,
      "eval_pointnav_pose_rmse_mean": 0.11980535835027695,
      "eval_pointnav_rmse_dtheta": 0.02598399668931961,
      "eval_pointnav_rmse_dx": 0.007412207778543234,
      "eval_pointnav_rmse_dy": 0.006358881946653128,
      "eval_pointnav_rmse_mean": 0.013251694850623608,
      "eval_pointnav_rotation_flip": 0.005512950476258993,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08917610347270966,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 9000
    },
    {
      "epoch": 0.4181378925850214,
      "eval_loss": 0.2205659200747808,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30081185698509216,
      "eval_objectnav_nopose_mae_dtheta": 0.03970785066485405,
      "eval_objectnav_nopose_mae_dx": 0.013216397725045681,
      "eval_objectnav_nopose_mae_dy": 0.005047393497079611,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31942740082740784,
      "eval_objectnav_nopose_pose_mae_dx": 0.10501548647880554,
      "eval_objectnav_nopose_pose_mae_dy": 0.055906329303979874,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5395538210868835,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22779430449008942,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13252680003643036,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29995831847190857,
      "eval_objectnav_nopose_rmse_dtheta": 0.05762484669685364,
      "eval_objectnav_nopose_rmse_dx": 0.025727389380335808,
      "eval_objectnav_nopose_rmse_dy": 0.010387546382844448,
      "eval_objectnav_nopose_rmse_mean": 0.031246595084667206,
      "eval_objectnav_nopose_rotation_flip": 0.016686083748936653,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30081185698509216,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2717097997665405,
      "eval_objectnav_pose_mae_dtheta": 0.03500090911984444,
      "eval_objectnav_pose_mae_dx": 0.01123199425637722,
      "eval_objectnav_pose_mae_dy": 0.0046843113377690315,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26161983609199524,
      "eval_objectnav_pose_pose_mae_dx": 0.08787408471107483,
      "eval_objectnav_pose_pose_mae_dy": 0.04808947071433067,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4609721899032593,
      "eval_objectnav_pose_pose_rmse_dx": 0.2020343393087387,
      "eval_objectnav_pose_pose_rmse_dy": 0.11439962685108185,
      "eval_objectnav_pose_pose_rmse_mean": 0.2591353952884674,
      "eval_objectnav_pose_rmse_dtheta": 0.052789267152547836,
      "eval_objectnav_pose_rmse_dx": 0.023241324350237846,
      "eval_objectnav_pose_rmse_dy": 0.009653078392148018,
      "eval_objectnav_pose_rmse_mean": 0.028561223298311234,
      "eval_objectnav_pose_rotation_flip": 0.015713978558778763,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2717097997665405,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08917610347270966,
      "eval_pointnav_mae_dtheta": 0.010438154451549053,
      "eval_pointnav_mae_dx": 0.002294652396813035,
      "eval_pointnav_mae_dy": 0.002375261625275016,
      "eval_pointnav_pose_mae_dtheta": 0.07185567915439606,
      "eval_pointnav_pose_mae_dx": 0.025718150660395622,
      "eval_pointnav_pose_mae_dy": 0.024835871532559395,
      "eval_pointnav_pose_rmse_dtheta": 0.20806455612182617,
      "eval_pointnav_pose_rmse_dx": 0.07963652163743973,
      "eval_pointnav_pose_rmse_dy": 0.07171500474214554,
      "eval_pointnav_pose_rmse_mean": 0.11980535835027695,
      "eval_pointnav_rmse_dtheta": 0.02598399668931961,
      "eval_pointnav_rmse_dx": 0.007412207778543234,
      "eval_pointnav_rmse_dy": 0.006358881946653128,
      "eval_pointnav_rmse_mean": 0.013251694850623608,
      "eval_pointnav_rotation_flip": 0.005512950476258993,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08917610347270966,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 9000
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.41818435235086415,
      "grad_norm": 0.6385734677314758,
      "learning_rate": 1.4926255614683931e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.029500089585781097,
      "mae_dx": 0.0075070057064294815,
      "mae_dy": 0.004351251292973757,
      "pose_mae_dtheta": 0.22528581321239471,
      "pose_mae_dx": 0.06258614361286163,
      "pose_mae_dy": 0.06880299001932144,
      "pose_rmse_dtheta": 0.40280836820602417,
      "pose_rmse_dx": 0.17510651051998138,
      "pose_rmse_dy": 0.13169679045677185,
      "pose_rmse_mean": 0.23653721809387207,
      "rmse_dtheta": 0.04379493370652199,
      "rmse_dx": 0.019174719229340553,
      "rmse_dy": 0.007216166704893112,
      "rmse_mean": 0.023395275697112083,
      "rotation_flip": 0.009592326357960701,
      "sparse_tokens": 7046.0,
      "step": 9001,
      "turn_loss": 0.19031603634357452,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 37963.0,
      "epoch": 0.41823081211670693,
      "grad_norm": 0.592155396938324,
      "learning_rate": 1.491683346248216e-06,
      "loss": 0.1484,
      "mae_dtheta": 0.02759513258934021,
      "mae_dx": 0.009715898893773556,
      "mae_dy": 0.004036754835397005,
      "pose_mae_dtheta": 0.21973209083080292,
      "pose_mae_dx": 0.08008315414190292,
      "pose_mae_dy": 0.06001484766602516,
      "pose_rmse_dtheta": 0.4056806266307831,
      "pose_rmse_dx": 0.187849760055542,
      "pose_rmse_dy": 0.14333900809288025,
      "pose_rmse_mean": 0.2456231564283371,
      "rmse_dtheta": 0.044772956520318985,
      "rmse_dx": 0.022074058651924133,
      "rmse_dy": 0.007799855433404446,
      "rmse_mean": 0.02488229051232338,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 29863.0,
      "step": 9002,
      "turn_loss": 0.2038029432296753,
      "turns": 117.0,
      "turns_per_sample": 117.0
    },
    {
      "dense_tokens": 16887.0,
      "epoch": 0.4182772718825497,
      "grad_norm": 0.6071564555168152,
      "learning_rate": 1.490741376366504e-06,
      "loss": 0.1378,
      "mae_dtheta": 0.033095914870500565,
      "mae_dx": 0.012775558978319168,
      "mae_dy": 0.00808920431882143,
      "pose_mae_dtheta": 0.24542731046676636,
      "pose_mae_dx": 0.10536123067140579,
      "pose_mae_dy": 0.07703497260808945,
      "pose_rmse_dtheta": 0.4143388569355011,
      "pose_rmse_dx": 0.24268916249275208,
      "pose_rmse_dy": 0.20346547663211823,
      "pose_rmse_mean": 0.28683117032051086,
      "rmse_dtheta": 0.05014285445213318,
      "rmse_dx": 0.025786323472857475,
      "rmse_dy": 0.017865151166915894,
      "rmse_mean": 0.031264778226614,
      "rotation_flip": 0.02130325883626938,
      "sparse_tokens": 13122.0,
      "step": 9003,
      "turn_loss": 0.3069612681865692,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4183237316483925,
      "grad_norm": 0.46055781841278076,
      "learning_rate": 1.4897996518891328e-06,
      "loss": 0.1182,
      "mae_dtheta": 0.00906819012016058,
      "mae_dx": 0.0016141670057550073,
      "mae_dy": 0.002377389930188656,
      "pose_mae_dtheta": 0.05496147274971008,
      "pose_mae_dx": 0.02043437398970127,
      "pose_mae_dy": 0.023565394803881645,
      "pose_rmse_dtheta": 0.14150270819664001,
      "pose_rmse_dx": 0.05348099395632744,
      "pose_rmse_dy": 0.054262615740299225,
      "pose_rmse_mean": 0.08308210968971252,
      "rmse_dtheta": 0.01983974315226078,
      "rmse_dx": 0.004578069318085909,
      "rmse_dy": 0.005419245921075344,
      "rmse_mean": 0.009945685975253582,
      "rotation_flip": 0.0037531275302171707,
      "sparse_tokens": 32105.0,
      "step": 9004,
      "turn_loss": 0.07806626707315445,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16835.0,
      "epoch": 0.41837019141423526,
      "grad_norm": 0.5349216461181641,
      "learning_rate": 1.488858172881954e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.031460218131542206,
      "mae_dx": 0.008800210431218147,
      "mae_dy": 0.0048724012449383736,
      "pose_mae_dtheta": 0.2238948792219162,
      "pose_mae_dx": 0.06268905103206635,
      "pose_mae_dy": 0.06050672009587288,
      "pose_rmse_dtheta": 0.43416669964790344,
      "pose_rmse_dx": 0.14791253209114075,
      "pose_rmse_dy": 0.1380334198474884,
      "pose_rmse_mean": 0.24003756046295166,
      "rmse_dtheta": 0.05204176902770996,
      "rmse_dx": 0.020567715167999268,
      "rmse_dy": 0.009229804389178753,
      "rmse_mean": 0.02727976255118847,
      "rotation_flip": 0.012000000104308128,
      "sparse_tokens": 13494.0,
      "step": 9005,
      "turn_loss": 0.22003763914108276,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.41841665118007804,
      "grad_norm": 0.7391055822372437,
      "learning_rate": 1.487916939410808e-06,
      "loss": 0.2113,
      "mae_dtheta": 0.04683782905340195,
      "mae_dx": 0.01194022223353386,
      "mae_dy": 0.00390443904325366,
      "pose_mae_dtheta": 0.4288235008716583,
      "pose_mae_dx": 0.08642972260713577,
      "pose_mae_dy": 0.04068094119429588,
      "pose_rmse_dtheta": 0.6764963269233704,
      "pose_rmse_dx": 0.21646952629089355,
      "pose_rmse_dy": 0.10751460492610931,
      "pose_rmse_mean": 0.3334934711456299,
      "rmse_dtheta": 0.06730261445045471,
      "rmse_dx": 0.024559102952480316,
      "rmse_dy": 0.009098242968320847,
      "rmse_mean": 0.033653318881988525,
      "rotation_flip": 0.017743980512022972,
      "sparse_tokens": 12709.0,
      "step": 9006,
      "turn_loss": 0.3599177300930023,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.4184631109459208,
      "grad_norm": 1.436264157295227,
      "learning_rate": 1.4869759515415167e-06,
      "loss": 0.1732,
      "mae_dtheta": 0.038725316524505615,
      "mae_dx": 0.010802783071994781,
      "mae_dy": 0.004470642190426588,
      "pose_mae_dtheta": 0.28930723667144775,
      "pose_mae_dx": 0.07398199290037155,
      "pose_mae_dy": 0.05238052085042,
      "pose_rmse_dtheta": 0.42989903688430786,
      "pose_rmse_dx": 0.15928597748279572,
      "pose_rmse_dy": 0.1198139488697052,
      "pose_rmse_mean": 0.2363329827785492,
      "rmse_dtheta": 0.053314127027988434,
      "rmse_dx": 0.02188807725906372,
      "rmse_dy": 0.009133750572800636,
      "rmse_mean": 0.028111984953284264,
      "rotation_flip": 0.01715686358511448,
      "sparse_tokens": 6896.0,
      "step": 9007,
      "turn_loss": 0.27346113324165344,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4185095707117636,
      "grad_norm": 0.3862927556037903,
      "learning_rate": 1.4860352093398817e-06,
      "loss": 0.1104,
      "mae_dtheta": 0.008561389520764351,
      "mae_dx": 0.001278155716136098,
      "mae_dy": 0.0017086085863411427,
      "pose_mae_dtheta": 0.05373344570398331,
      "pose_mae_dx": 0.017285611480474472,
      "pose_mae_dy": 0.02095562405884266,
      "pose_rmse_dtheta": 0.14680776000022888,
      "pose_rmse_dx": 0.04133987054228783,
      "pose_rmse_dy": 0.047130223363637924,
      "pose_rmse_mean": 0.07842595875263214,
      "rmse_dtheta": 0.01943562552332878,
      "rmse_dx": 0.003826132044196129,
      "rmse_dy": 0.003663914743810892,
      "rmse_mean": 0.008975224569439888,
      "rotation_flip": 0.0024429967161267996,
      "sparse_tokens": 32105.0,
      "step": 9008,
      "turn_loss": 0.06183089688420296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.41855603047760637,
      "grad_norm": 0.38491860032081604,
      "learning_rate": 1.4850947128716914e-06,
      "loss": 0.098,
      "mae_dtheta": 0.004605322144925594,
      "mae_dx": 0.0008767661056481302,
      "mae_dy": 0.0006288355216383934,
      "pose_mae_dtheta": 0.034048162400722504,
      "pose_mae_dx": 0.008133995346724987,
      "pose_mae_dy": 0.012057595886290073,
      "pose_rmse_dtheta": 0.11260254681110382,
      "pose_rmse_dx": 0.02334052510559559,
      "pose_rmse_dy": 0.03305922448635101,
      "pose_rmse_mean": 0.05633410066366196,
      "rmse_dtheta": 0.015840500593185425,
      "rmse_dx": 0.003189970040693879,
      "rmse_dy": 0.001340404967777431,
      "rmse_mean": 0.006790291517972946,
      "rotation_flip": 0.0029739777091890574,
      "sparse_tokens": 32105.0,
      "step": 9009,
      "turn_loss": 0.029401350766420364,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4186024902434492,
      "grad_norm": 0.6173879504203796,
      "learning_rate": 1.4841544622027133e-06,
      "loss": 0.1382,
      "mae_dtheta": 0.010140414349734783,
      "mae_dx": 0.0020012555178254843,
      "mae_dy": 0.002962263999506831,
      "pose_mae_dtheta": 0.07653825730085373,
      "pose_mae_dx": 0.02733047865331173,
      "pose_mae_dy": 0.035797830671072006,
      "pose_rmse_dtheta": 0.19234886765480042,
      "pose_rmse_dx": 0.08290168642997742,
      "pose_rmse_dy": 0.0963764637708664,
      "pose_rmse_mean": 0.1238756775856018,
      "rmse_dtheta": 0.0223968755453825,
      "rmse_dx": 0.006180683150887489,
      "rmse_dy": 0.007761633489280939,
      "rmse_mean": 0.012113064527511597,
      "rotation_flip": 0.0014851485611870885,
      "sparse_tokens": 32073.0,
      "step": 9010,
      "turn_loss": 0.0852794200181961,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.418648950009292,
      "grad_norm": 0.6254303455352783,
      "learning_rate": 1.4832144573987023e-06,
      "loss": 0.1421,
      "mae_dtheta": 0.008155526593327522,
      "mae_dx": 0.0015491389203816652,
      "mae_dy": 0.0005000849487259984,
      "pose_mae_dtheta": 0.05803234875202179,
      "pose_mae_dx": 0.010789012536406517,
      "pose_mae_dy": 0.005916681606322527,
      "pose_rmse_dtheta": 0.2293628454208374,
      "pose_rmse_dx": 0.029790060594677925,
      "pose_rmse_dy": 0.0158757995814085,
      "pose_rmse_mean": 0.09167623519897461,
      "rmse_dtheta": 0.027574416249990463,
      "rmse_dx": 0.004974606912583113,
      "rmse_dy": 0.0013966717524453998,
      "rmse_mean": 0.011315232142806053,
      "rotation_flip": 0.0016685206210240722,
      "sparse_tokens": 32201.0,
      "step": 9011,
      "turn_loss": 0.06315162032842636,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.41869540977513475,
      "grad_norm": 0.39366644620895386,
      "learning_rate": 1.4822746985253905e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.009961758740246296,
      "mae_dx": 0.002073124283924699,
      "mae_dy": 0.0022105337120592594,
      "pose_mae_dtheta": 0.07082324475049973,
      "pose_mae_dx": 0.025535691529512405,
      "pose_mae_dy": 0.027818720787763596,
      "pose_rmse_dtheta": 0.21589694917201996,
      "pose_rmse_dx": 0.07173759490251541,
      "pose_rmse_dy": 0.07390537112951279,
      "pose_rmse_mean": 0.12051331251859665,
      "rmse_dtheta": 0.02574952132999897,
      "rmse_dx": 0.006008598487824202,
      "rmse_dy": 0.005936473608016968,
      "rmse_mean": 0.01256486400961876,
      "rotation_flip": 0.004324843641370535,
      "sparse_tokens": 32089.0,
      "step": 9012,
      "turn_loss": 0.09512165188789368,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.41874186954097753,
      "grad_norm": 0.37720057368278503,
      "learning_rate": 1.4813351856484981e-06,
      "loss": 0.0985,
      "mae_dtheta": 0.007609953172504902,
      "mae_dx": 0.0010213643545284867,
      "mae_dy": 0.001572002423927188,
      "pose_mae_dtheta": 0.04798206686973572,
      "pose_mae_dx": 0.013286692090332508,
      "pose_mae_dy": 0.019523445516824722,
      "pose_rmse_dtheta": 0.14678984880447388,
      "pose_rmse_dx": 0.03330851346254349,
      "pose_rmse_dy": 0.040535058826208115,
      "pose_rmse_mean": 0.0735444724559784,
      "rmse_dtheta": 0.019030144438147545,
      "rmse_dx": 0.003124693175777793,
      "rmse_dy": 0.003305921098217368,
      "rmse_mean": 0.008486920036375523,
      "rotation_flip": 0.004152823705226183,
      "sparse_tokens": 32073.0,
      "step": 9013,
      "turn_loss": 0.06050443649291992,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.4187883293068203,
      "grad_norm": 0.71075439453125,
      "learning_rate": 1.4803959188337253e-06,
      "loss": 0.139,
      "mae_dtheta": 0.0347815565764904,
      "mae_dx": 0.010753052309155464,
      "mae_dy": 0.01722414419054985,
      "pose_mae_dtheta": 0.25835585594177246,
      "pose_mae_dx": 0.12611155211925507,
      "pose_mae_dy": 0.12400494515895844,
      "pose_rmse_dtheta": 0.48715999722480774,
      "pose_rmse_dx": 0.2846510708332062,
      "pose_rmse_dy": 0.28903427720069885,
      "pose_rmse_mean": 0.3536151349544525,
      "rmse_dtheta": 0.05633610114455223,
      "rmse_dx": 0.020068354904651642,
      "rmse_dy": 0.032237280160188675,
      "rmse_mean": 0.036213912069797516,
      "rotation_flip": 0.02427184395492077,
      "sparse_tokens": 2961.0,
      "step": 9014,
      "turn_loss": 0.40466055274009705,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4188347890726631,
      "grad_norm": 0.3936642110347748,
      "learning_rate": 1.4794568981467532e-06,
      "loss": 0.1107,
      "mae_dtheta": 0.010822302661836147,
      "mae_dx": 0.0013371716486290097,
      "mae_dy": 0.002219647169113159,
      "pose_mae_dtheta": 0.06543512642383575,
      "pose_mae_dx": 0.02119094505906105,
      "pose_mae_dy": 0.03147265315055847,
      "pose_rmse_dtheta": 0.12651890516281128,
      "pose_rmse_dx": 0.05940050259232521,
      "pose_rmse_dy": 0.07274311780929565,
      "pose_rmse_mean": 0.08622084558010101,
      "rmse_dtheta": 0.020134566351771355,
      "rmse_dx": 0.004793999716639519,
      "rmse_dy": 0.004593530669808388,
      "rmse_mean": 0.009840698912739754,
      "rotation_flip": 0.0068859984166920185,
      "sparse_tokens": 32041.0,
      "step": 9015,
      "turn_loss": 0.0828273668885231,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.41888124883850586,
      "grad_norm": 0.7351460456848145,
      "learning_rate": 1.4785181236532514e-06,
      "loss": 0.1338,
      "mae_dtheta": 0.02416742406785488,
      "mae_dx": 0.010681617073714733,
      "mae_dy": 0.005241101607680321,
      "pose_mae_dtheta": 0.17250241339206696,
      "pose_mae_dx": 0.08171267807483673,
      "pose_mae_dy": 0.07061124593019485,
      "pose_rmse_dtheta": 0.31835031509399414,
      "pose_rmse_dx": 0.198762446641922,
      "pose_rmse_dy": 0.16625553369522095,
      "pose_rmse_mean": 0.22778943181037903,
      "rmse_dtheta": 0.04029276967048645,
      "rmse_dx": 0.02297929674386978,
      "rmse_dy": 0.011222327128052711,
      "rmse_mean": 0.024831464514136314,
      "rotation_flip": 0.010126582346856594,
      "sparse_tokens": 17575.0,
      "step": 9016,
      "turn_loss": 0.27105727791786194,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.41892770860434864,
      "grad_norm": 1.0165051221847534,
      "learning_rate": 1.4775795954188655e-06,
      "loss": 0.2616,
      "mae_dtheta": 0.033872511237859726,
      "mae_dx": 0.009821505285799503,
      "mae_dy": 0.0037411879748106003,
      "pose_mae_dtheta": 0.2546238303184509,
      "pose_mae_dx": 0.07799773663282394,
      "pose_mae_dy": 0.03718128055334091,
      "pose_rmse_dtheta": 0.4669353663921356,
      "pose_rmse_dx": 0.17450064420700073,
      "pose_rmse_dy": 0.09881974011659622,
      "pose_rmse_mean": 0.24675190448760986,
      "rmse_dtheta": 0.05278296023607254,
      "rmse_dx": 0.020263895392417908,
      "rmse_dy": 0.007651404943317175,
      "rmse_mean": 0.026899419724941254,
      "rotation_flip": 0.00906344410032034,
      "sparse_tokens": 16001.0,
      "step": 9017,
      "turn_loss": 0.2562459409236908,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 30495.0,
      "epoch": 0.4189741683701914,
      "grad_norm": 0.691792368888855,
      "learning_rate": 1.4766413135092311e-06,
      "loss": 0.1806,
      "mae_dtheta": 0.03203524649143219,
      "mae_dx": 0.007710083853453398,
      "mae_dy": 0.0050566960126161575,
      "pose_mae_dtheta": 0.25314679741859436,
      "pose_mae_dx": 0.05420332029461861,
      "pose_mae_dy": 0.06205128878355026,
      "pose_rmse_dtheta": 0.4694257080554962,
      "pose_rmse_dx": 0.1299147754907608,
      "pose_rmse_dy": 0.18572686612606049,
      "pose_rmse_mean": 0.26168912649154663,
      "rmse_dtheta": 0.05028323456645012,
      "rmse_dx": 0.018192393705248833,
      "rmse_dy": 0.011284423060715199,
      "rmse_mean": 0.026586685329675674,
      "rotation_flip": 0.016005566343665123,
      "sparse_tokens": 22498.0,
      "step": 9018,
      "turn_loss": 0.2366762012243271,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4190206281360342,
      "grad_norm": 0.553602933883667,
      "learning_rate": 1.4757032779899588e-06,
      "loss": 0.1685,
      "mae_dtheta": 0.011134921573102474,
      "mae_dx": 0.0014960383996367455,
      "mae_dy": 0.0030560195446014404,
      "pose_mae_dtheta": 0.07153835147619247,
      "pose_mae_dx": 0.024636533111333847,
      "pose_mae_dy": 0.03575892001390457,
      "pose_rmse_dtheta": 0.14658497273921967,
      "pose_rmse_dx": 0.06593327224254608,
      "pose_rmse_dy": 0.08291102945804596,
      "pose_rmse_mean": 0.09847643226385117,
      "rmse_dtheta": 0.021360117942094803,
      "rmse_dx": 0.00449327053502202,
      "rmse_dy": 0.006462041288614273,
      "rmse_mean": 0.010771810077130795,
      "rotation_flip": 0.002773925196379423,
      "sparse_tokens": 32073.0,
      "step": 9019,
      "turn_loss": 0.09188869595527649,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.41906708790187697,
      "grad_norm": 0.3676483631134033,
      "learning_rate": 1.4747654889266483e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.02395053207874298,
      "mae_dx": 0.006672034040093422,
      "mae_dy": 0.003178572980687022,
      "pose_mae_dtheta": 0.16600240767002106,
      "pose_mae_dx": 0.06631062179803848,
      "pose_mae_dy": 0.05579033121466637,
      "pose_rmse_dtheta": 0.2894672453403473,
      "pose_rmse_dx": 0.1878732442855835,
      "pose_rmse_dy": 0.11301146447658539,
      "pose_rmse_mean": 0.19678398966789246,
      "rmse_dtheta": 0.037694308906793594,
      "rmse_dx": 0.01832645945250988,
      "rmse_dy": 0.005644317716360092,
      "rmse_mean": 0.020555028691887856,
      "rotation_flip": 0.010080644860863686,
      "sparse_tokens": 10797.0,
      "step": 9020,
      "turn_loss": 0.2071601152420044,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.41911354766771974,
      "grad_norm": 0.46861952543258667,
      "learning_rate": 1.4738279463848803e-06,
      "loss": 0.0915,
      "mae_dtheta": 0.011829225346446037,
      "mae_dx": 0.002210593316704035,
      "mae_dy": 0.002100955927744508,
      "pose_mae_dtheta": 0.08249372243881226,
      "pose_mae_dx": 0.024803748354315758,
      "pose_mae_dy": 0.024857670068740845,
      "pose_rmse_dtheta": 0.23693858087062836,
      "pose_rmse_dx": 0.09047207981348038,
      "pose_rmse_dy": 0.081117644906044,
      "pose_rmse_mean": 0.13617610931396484,
      "rmse_dtheta": 0.02956647239625454,
      "rmse_dx": 0.008664010092616081,
      "rmse_dy": 0.007039187476038933,
      "rmse_mean": 0.015089889988303185,
      "rotation_flip": 0.0024900399148464203,
      "sparse_tokens": 32057.0,
      "step": 9021,
      "turn_loss": 0.09464764595031738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.4191600074335625,
      "grad_norm": 0.5284384489059448,
      "learning_rate": 1.4728906504302153e-06,
      "loss": 0.1658,
      "mae_dtheta": 0.03064287267625332,
      "mae_dx": 0.008533300831913948,
      "mae_dy": 0.004775561857968569,
      "pose_mae_dtheta": 0.23726069927215576,
      "pose_mae_dx": 0.08268427848815918,
      "pose_mae_dy": 0.05654282867908478,
      "pose_rmse_dtheta": 0.4636061191558838,
      "pose_rmse_dx": 0.19148150086402893,
      "pose_rmse_dy": 0.14920061826705933,
      "pose_rmse_mean": 0.26809608936309814,
      "rmse_dtheta": 0.049107663333415985,
      "rmse_dx": 0.019543562084436417,
      "rmse_dy": 0.010294673964381218,
      "rmse_mean": 0.026315301656723022,
      "rotation_flip": 0.013599274680018425,
      "sparse_tokens": 19429.0,
      "step": 9022,
      "turn_loss": 0.2532097101211548,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4192064671994053,
      "grad_norm": 0.6488319039344788,
      "learning_rate": 1.471953601128202e-06,
      "loss": 0.1249,
      "mae_dtheta": 0.011974632740020752,
      "mae_dx": 0.0024121322203427553,
      "mae_dy": 0.003395074512809515,
      "pose_mae_dtheta": 0.07871066778898239,
      "pose_mae_dx": 0.027490630745887756,
      "pose_mae_dy": 0.037112295627593994,
      "pose_rmse_dtheta": 0.17861728370189667,
      "pose_rmse_dx": 0.07061673700809479,
      "pose_rmse_dy": 0.09054940193891525,
      "pose_rmse_mean": 0.1132611483335495,
      "rmse_dtheta": 0.025612723082304,
      "rmse_dx": 0.0077466703951358795,
      "rmse_dy": 0.008165762759745121,
      "rmse_mean": 0.013841718435287476,
      "rotation_flip": 0.0070304651744663715,
      "sparse_tokens": 32153.0,
      "step": 9023,
      "turn_loss": 0.12225109338760376,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4192529269652481,
      "grad_norm": 0.3488237261772156,
      "learning_rate": 1.4710167985443651e-06,
      "loss": 0.0797,
      "mae_dtheta": 0.007136608008295298,
      "mae_dx": 0.001209201873280108,
      "mae_dy": 0.0017766020027920604,
      "pose_mae_dtheta": 0.04233478382229805,
      "pose_mae_dx": 0.01515743788331747,
      "pose_mae_dy": 0.020379455760121346,
      "pose_rmse_dtheta": 0.0850888192653656,
      "pose_rmse_dx": 0.038034118711948395,
      "pose_rmse_dy": 0.04585940018296242,
      "pose_rmse_mean": 0.056327447295188904,
      "rmse_dtheta": 0.01433683279901743,
      "rmse_dx": 0.003523893654346466,
      "rmse_dy": 0.003626214573159814,
      "rmse_mean": 0.0071623134426772594,
      "rotation_flip": 0.009265858680009842,
      "sparse_tokens": 32153.0,
      "step": 9024,
      "turn_loss": 0.06084432825446129,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.41929938673109085,
      "grad_norm": 0.43534955382347107,
      "learning_rate": 1.470080242744218e-06,
      "loss": 0.1138,
      "mae_dtheta": 0.010147023014724255,
      "mae_dx": 0.0015095215057954192,
      "mae_dy": 0.0020710143726319075,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.43534961342811584,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.84652709960938,
      "model/head/act_norm_mean": 109.52223405934343,
      "model/head/act_norm_min": 60.52413558959961,
      "model/head/act_over_embed": 75.26470460889094,
      "model/head/grad_frac": 0.11652372032403946,
      "model/head/grad_norm": 0.050728555768728256,
      "model/head/grad_zero_frac": 0.00018909397476818413,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7049992108585859,
      "model/head/update_ratio": 0.000863842957187444,
      "model/head/weight_delta": 9.861623764038086,
      "model/head/weight_delta_rel": 0.17300209403038025,
      "model/head/weight_norm": 58.724281311035156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4226660430431366,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42261463700376484,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4225410521030426,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29042473512955574,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09632904827594757,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04193681478500366,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5504189055429864,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013541694497689605,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1326231956481934,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1023525670170784,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968660354614258,
      "model/modality_embedder/grad_frac": 0.09632904827594757,
      "model/modality_embedder/grad_norm": 0.04193681478500366,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5504189055429864,
      "model/modality_embedder/update_ratio": 0.0013541694497689605,
      "model/modality_embedder/weight_delta": 3.1326231956481934,
      "model/modality_embedder/weight_delta_rel": 0.1023525670170784,
      "model/modality_embedder/weight_norm": 30.968660354614258,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.17498779296875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.5466670675004,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.092768669128418,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.181490056156566,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.058537792414426804,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02548440545797348,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009118905290961266,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6783618927001953,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09760112315416336,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.946781158447266,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 94.06873321533203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.525736030944365,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.3364896774292,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.85431541402331,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.060919925570487976,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0265214666724205,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0003833118244074285,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008915408398024738,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3956756591796875,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11762885749340057,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.74789810180664,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.617919921875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.34294332210999,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.323418617248535,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.10311727747503,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.060793280601501465,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.026466330513358116,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000861588167026639,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6753945350646973,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12341286987066269,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.718074798583984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.25935363769531,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.05213844797178,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.175687789916992,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.277692169704135,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.054364655166864395,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.023667631670832634,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0003833118244074285,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007906012469902635,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.154026508331299,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10778965801000595,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.936243057250977,
      "model/normalizer/grad_frac": 0.18649405241012573,
      "model/normalizer/grad_norm": 0.08119011670351028,
      "model/normalizer/grad_zero_frac": 0.00030607025837525725,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010325305629521608,
      "model/normalizer/weight_delta": 6.644191741943359,
      "model/normalizer/weight_delta_rel": 0.08557334542274475,
      "model/normalizer/weight_norm": 78.63216400146484,
      "pose_mae_dtheta": 0.06553051620721817,
      "pose_mae_dx": 0.018424665555357933,
      "pose_mae_dy": 0.024854162707924843,
      "pose_rmse_dtheta": 0.1549224853515625,
      "pose_rmse_dx": 0.05278582125902176,
      "pose_rmse_dy": 0.05947516858577728,
      "pose_rmse_mean": 0.08906116336584091,
      "rmse_dtheta": 0.02238689363002777,
      "rmse_dx": 0.004736335948109627,
      "rmse_dy": 0.005426820367574692,
      "rmse_mean": 0.01085001789033413,
      "rotation_flip": 0.006415740121155977,
      "sparse_tokens": 32089.0,
      "step": 9025,
      "turn_loss": 0.07962305098772049,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30723.0,
      "epoch": 0.4193458464969337,
      "grad_norm": 0.4311942160129547,
      "learning_rate": 1.469143933793255e-06,
      "loss": 0.0936,
      "mae_dtheta": 0.02007019706070423,
      "mae_dx": 0.008199351839721203,
      "mae_dy": 0.003733544610440731,
      "pose_mae_dtheta": 0.15737512707710266,
      "pose_mae_dx": 0.07039540261030197,
      "pose_mae_dy": 0.055178605020046234,
      "pose_rmse_dtheta": 0.28142499923706055,
      "pose_rmse_dx": 0.2012624740600586,
      "pose_rmse_dy": 0.1218864694237709,
      "pose_rmse_mean": 0.20152465999126434,
      "rmse_dtheta": 0.03266255185008049,
      "rmse_dx": 0.020951619371771812,
      "rmse_dy": 0.008237808011472225,
      "rmse_mean": 0.020617326721549034,
      "rotation_flip": 0.014044944196939468,
      "sparse_tokens": 23433.0,
      "step": 9026,
      "turn_loss": 0.17300085723400116,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.41939230626277646,
      "grad_norm": 0.6967306733131409,
      "learning_rate": 1.4682078717569508e-06,
      "loss": 0.136,
      "mae_dtheta": 0.02683115191757679,
      "mae_dx": 0.007286351174116135,
      "mae_dy": 0.003667061682790518,
      "pose_mae_dtheta": 0.17891409993171692,
      "pose_mae_dx": 0.05994553118944168,
      "pose_mae_dy": 0.030016005039215088,
      "pose_rmse_dtheta": 0.30052340030670166,
      "pose_rmse_dx": 0.13140557706356049,
      "pose_rmse_dy": 0.059721916913986206,
      "pose_rmse_mean": 0.16388364136219025,
      "rmse_dtheta": 0.03824174031615257,
      "rmse_dx": 0.015037362463772297,
      "rmse_dy": 0.007106421981006861,
      "rmse_mean": 0.020128509029746056,
      "rotation_flip": 0.010471204295754433,
      "sparse_tokens": 3198.0,
      "step": 9027,
      "turn_loss": 0.2216300070285797,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.41943876602861924,
      "grad_norm": 0.5488490462303162,
      "learning_rate": 1.4672720567007675e-06,
      "loss": 0.0805,
      "mae_dtheta": 0.02304961159825325,
      "mae_dx": 0.007332144305109978,
      "mae_dy": 0.003595127956941724,
      "pose_mae_dtheta": 0.17978157103061676,
      "pose_mae_dx": 0.062089622020721436,
      "pose_mae_dy": 0.04314381256699562,
      "pose_rmse_dtheta": 0.4001551866531372,
      "pose_rmse_dx": 0.17537304759025574,
      "pose_rmse_dy": 0.12417741119861603,
      "pose_rmse_mean": 0.2332352250814438,
      "rmse_dtheta": 0.04306834191083908,
      "rmse_dx": 0.01901925355195999,
      "rmse_dy": 0.009208285249769688,
      "rmse_mean": 0.02376529388129711,
      "rotation_flip": 0.008169935084879398,
      "sparse_tokens": 11833.0,
      "step": 9028,
      "turn_loss": 0.15894104540348053,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.419485225794462,
      "grad_norm": 0.541465163230896,
      "learning_rate": 1.4663364886901439e-06,
      "loss": 0.2015,
      "mae_dtheta": 0.03872618079185486,
      "mae_dx": 0.014547399245202541,
      "mae_dy": 0.006591403856873512,
      "pose_mae_dtheta": 0.3553062677383423,
      "pose_mae_dx": 0.11270827800035477,
      "pose_mae_dy": 0.07239414006471634,
      "pose_rmse_dtheta": 0.6215593218803406,
      "pose_rmse_dx": 0.24734845757484436,
      "pose_rmse_dy": 0.18038316071033478,
      "pose_rmse_mean": 0.3497636914253235,
      "rmse_dtheta": 0.060277558863162994,
      "rmse_dx": 0.0276787206530571,
      "rmse_dy": 0.016701338812708855,
      "rmse_mean": 0.03488587588071823,
      "rotation_flip": 0.007499999832361937,
      "sparse_tokens": 13142.0,
      "step": 9029,
      "turn_loss": 0.2985500991344452,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.4195316855603048,
      "grad_norm": 0.5925710201263428,
      "learning_rate": 1.4654011677905071e-06,
      "loss": 0.1175,
      "mae_dtheta": 0.03953137621283531,
      "mae_dx": 0.010890032164752483,
      "mae_dy": 0.006604570895433426,
      "pose_mae_dtheta": 0.3483997583389282,
      "pose_mae_dx": 0.0852833166718483,
      "pose_mae_dy": 0.0709761306643486,
      "pose_rmse_dtheta": 0.5919753313064575,
      "pose_rmse_dx": 0.20599092543125153,
      "pose_rmse_dy": 0.17030353844165802,
      "pose_rmse_mean": 0.3227565884590149,
      "rmse_dtheta": 0.058660849928855896,
      "rmse_dx": 0.023448562249541283,
      "rmse_dy": 0.013527117669582367,
      "rmse_mean": 0.031878843903541565,
      "rotation_flip": 0.030997304245829582,
      "sparse_tokens": 11888.0,
      "step": 9030,
      "turn_loss": 0.2982228398323059,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 32114.0,
      "epoch": 0.41957814532614757,
      "grad_norm": 0.4428786635398865,
      "learning_rate": 1.4644660940672628e-06,
      "loss": 0.152,
      "mae_dtheta": 0.029116801917552948,
      "mae_dx": 0.009286211803555489,
      "mae_dy": 0.004714378155767918,
      "pose_mae_dtheta": 0.2188173085451126,
      "pose_mae_dx": 0.07571514695882797,
      "pose_mae_dy": 0.04595142975449562,
      "pose_rmse_dtheta": 0.39573389291763306,
      "pose_rmse_dx": 0.18099114298820496,
      "pose_rmse_dy": 0.10260084271430969,
      "pose_rmse_mean": 0.22644194960594177,
      "rmse_dtheta": 0.04613155126571655,
      "rmse_dx": 0.020732847973704338,
      "rmse_dy": 0.009293298237025738,
      "rmse_mean": 0.0253858994692564,
      "rotation_flip": 0.007628294173628092,
      "sparse_tokens": 24766.0,
      "step": 9031,
      "turn_loss": 0.23438748717308044,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.41962460509199034,
      "grad_norm": 0.468789666891098,
      "learning_rate": 1.4635312675858021e-06,
      "loss": 0.0972,
      "mae_dtheta": 0.010911568999290466,
      "mae_dx": 0.0016381517052650452,
      "mae_dy": 0.0030899306293576956,
      "pose_mae_dtheta": 0.07627968490123749,
      "pose_mae_dx": 0.026071105152368546,
      "pose_mae_dy": 0.03156445547938347,
      "pose_rmse_dtheta": 0.16983430087566376,
      "pose_rmse_dx": 0.06929431110620499,
      "pose_rmse_dy": 0.06630519032478333,
      "pose_rmse_mean": 0.10181127488613129,
      "rmse_dtheta": 0.021176395937800407,
      "rmse_dx": 0.004560757894068956,
      "rmse_dy": 0.006602401379495859,
      "rmse_mean": 0.0107798520475626,
      "rotation_flip": 0.0028040658216923475,
      "sparse_tokens": 32057.0,
      "step": 9032,
      "turn_loss": 0.08847424387931824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4196710648578331,
      "grad_norm": 0.4303920269012451,
      "learning_rate": 1.4625966884114994e-06,
      "loss": 0.1175,
      "mae_dtheta": 0.008447252213954926,
      "mae_dx": 0.0010458823526278138,
      "mae_dy": 0.0016162655083462596,
      "pose_mae_dtheta": 0.0526227205991745,
      "pose_mae_dx": 0.01603882573544979,
      "pose_mae_dy": 0.022737139835953712,
      "pose_rmse_dtheta": 0.10787027329206467,
      "pose_rmse_dx": 0.03768555819988251,
      "pose_rmse_dy": 0.0500422827899456,
      "pose_rmse_mean": 0.06519937515258789,
      "rmse_dtheta": 0.017891574651002884,
      "rmse_dx": 0.003365421202033758,
      "rmse_dy": 0.003129261313006282,
      "rmse_mean": 0.008128752931952477,
      "rotation_flip": 0.002445984398946166,
      "sparse_tokens": 32089.0,
      "step": 9033,
      "turn_loss": 0.06414870172739029,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4197175246236759,
      "grad_norm": 0.480835884809494,
      "learning_rate": 1.4616623566097076e-06,
      "loss": 0.1269,
      "mae_dtheta": 0.007482781074941158,
      "mae_dx": 0.001669416669756174,
      "mae_dy": 0.001669720048084855,
      "pose_mae_dtheta": 0.05388280004262924,
      "pose_mae_dx": 0.019101450219750404,
      "pose_mae_dy": 0.020044498145580292,
      "pose_rmse_dtheta": 0.14982880651950836,
      "pose_rmse_dx": 0.05837644264101982,
      "pose_rmse_dy": 0.04899321123957634,
      "pose_rmse_mean": 0.08573281764984131,
      "rmse_dtheta": 0.017608804628252983,
      "rmse_dx": 0.006386786233633757,
      "rmse_dy": 0.003796157194301486,
      "rmse_mean": 0.009263915941119194,
      "rotation_flip": 0.0037789323832839727,
      "sparse_tokens": 32073.0,
      "step": 9034,
      "turn_loss": 0.0588223822414875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4197639843895187,
      "grad_norm": 0.2865907549858093,
      "learning_rate": 1.4607282722457678e-06,
      "loss": 0.065,
      "mae_dtheta": 0.005039490759372711,
      "mae_dx": 0.0015223186928778887,
      "mae_dy": 0.0014932111371308565,
      "pose_mae_dtheta": 0.03143637627363205,
      "pose_mae_dx": 0.01573861390352249,
      "pose_mae_dy": 0.015552987344563007,
      "pose_rmse_dtheta": 0.0637582466006279,
      "pose_rmse_dx": 0.04094524309039116,
      "pose_rmse_dy": 0.03794821724295616,
      "pose_rmse_mean": 0.04755057021975517,
      "rmse_dtheta": 0.011494137346744537,
      "rmse_dx": 0.0043116468004882336,
      "rmse_dy": 0.00355990300886333,
      "rmse_mean": 0.006455229129642248,
      "rotation_flip": 0.003342884359881282,
      "sparse_tokens": 32089.0,
      "step": 9035,
      "turn_loss": 0.05852169916033745,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.41981044415536145,
      "grad_norm": 1.1919554471969604,
      "learning_rate": 1.459794435384998e-06,
      "loss": 0.1904,
      "mae_dtheta": 0.05794430896639824,
      "mae_dx": 0.00860620941966772,
      "mae_dy": 0.021126961335539818,
      "pose_mae_dtheta": 0.4511633515357971,
      "pose_mae_dx": 0.14198695123195648,
      "pose_mae_dy": 0.14115430414676666,
      "pose_rmse_dtheta": 0.8068597316741943,
      "pose_rmse_dx": 0.28472471237182617,
      "pose_rmse_dy": 0.31646376848220825,
      "pose_rmse_mean": 0.46934938430786133,
      "rmse_dtheta": 0.08742161095142365,
      "rmse_dx": 0.01531530637294054,
      "rmse_dy": 0.037895891815423965,
      "rmse_mean": 0.046877603977918625,
      "rotation_flip": 0.006756756920367479,
      "sparse_tokens": 2165.0,
      "step": 9036,
      "turn_loss": 0.6119184494018555,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4198569039212042,
      "grad_norm": 0.4824390709400177,
      "learning_rate": 1.458860846092705e-06,
      "loss": 0.1371,
      "mae_dtheta": 0.009514421224594116,
      "mae_dx": 0.001215885509736836,
      "mae_dy": 0.0015016457764431834,
      "pose_mae_dtheta": 0.06393540650606155,
      "pose_mae_dx": 0.010185005143284798,
      "pose_mae_dy": 0.013689734041690826,
      "pose_rmse_dtheta": 0.22940880060195923,
      "pose_rmse_dx": 0.028887562453746796,
      "pose_rmse_dy": 0.03574180603027344,
      "pose_rmse_mean": 0.09801273047924042,
      "rmse_dtheta": 0.027823681011795998,
      "rmse_dx": 0.0039606341160833836,
      "rmse_dy": 0.004193407949060202,
      "rmse_mean": 0.011992573738098145,
      "rotation_flip": 0.004473160952329636,
      "sparse_tokens": 32137.0,
      "step": 9037,
      "turn_loss": 0.05872698873281479,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.419903363687047,
      "grad_norm": 0.5131216645240784,
      "learning_rate": 1.4579275044341722e-06,
      "loss": 0.1542,
      "mae_dtheta": 0.03955186903476715,
      "mae_dx": 0.014553279615938663,
      "mae_dy": 0.004932713229209185,
      "pose_mae_dtheta": 0.3116585910320282,
      "pose_mae_dx": 0.120073601603508,
      "pose_mae_dy": 0.04756138473749161,
      "pose_rmse_dtheta": 0.5483049154281616,
      "pose_rmse_dx": 0.2736164629459381,
      "pose_rmse_dy": 0.10403113812208176,
      "pose_rmse_mean": 0.3086508512496948,
      "rmse_dtheta": 0.060035835951566696,
      "rmse_dx": 0.02813495136797428,
      "rmse_dy": 0.008986635133624077,
      "rmse_mean": 0.03238581120967865,
      "rotation_flip": 0.014084506779909134,
      "sparse_tokens": 7156.0,
      "step": 9038,
      "turn_loss": 0.2305961698293686,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.4199498234528898,
      "grad_norm": 0.6889793276786804,
      "learning_rate": 1.4569944104746703e-06,
      "loss": 0.1425,
      "mae_dtheta": 0.03319418802857399,
      "mae_dx": 0.01695386692881584,
      "mae_dy": 0.006902249064296484,
      "pose_mae_dtheta": 0.30435994267463684,
      "pose_mae_dx": 0.11662212014198303,
      "pose_mae_dy": 0.09952379763126373,
      "pose_rmse_dtheta": 0.4980338513851166,
      "pose_rmse_dx": 0.23555263876914978,
      "pose_rmse_dy": 0.20848464965820312,
      "pose_rmse_mean": 0.3140237331390381,
      "rmse_dtheta": 0.04803096130490303,
      "rmse_dx": 0.029560353606939316,
      "rmse_dy": 0.011526389978826046,
      "rmse_mean": 0.029705902561545372,
      "rotation_flip": 0.019417475908994675,
      "sparse_tokens": 6611.0,
      "step": 9039,
      "turn_loss": 0.29244065284729004,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.41999628321873256,
      "grad_norm": 0.6109034419059753,
      "learning_rate": 1.4560615642794519e-06,
      "loss": 0.1122,
      "mae_dtheta": 0.043262407183647156,
      "mae_dx": 0.010487736202776432,
      "mae_dy": 0.0047163949348032475,
      "pose_mae_dtheta": 0.3481942117214203,
      "pose_mae_dx": 0.07772515714168549,
      "pose_mae_dy": 0.05615471675992012,
      "pose_rmse_dtheta": 0.5896819233894348,
      "pose_rmse_dx": 0.18182986974716187,
      "pose_rmse_dy": 0.15667754411697388,
      "pose_rmse_mean": 0.3093964457511902,
      "rmse_dtheta": 0.0637676864862442,
      "rmse_dx": 0.02294701524078846,
      "rmse_dy": 0.011188316158950329,
      "rmse_mean": 0.03263434022665024,
      "rotation_flip": 0.007092198356986046,
      "sparse_tokens": 10279.0,
      "step": 9040,
      "turn_loss": 0.28090304136276245,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.42004274298457533,
      "grad_norm": 0.6232637166976929,
      "learning_rate": 1.4551289659137497e-06,
      "loss": 0.1234,
      "mae_dtheta": 0.02417895942926407,
      "mae_dx": 0.01007034070789814,
      "mae_dy": 0.002902551321312785,
      "pose_mae_dtheta": 0.1845729649066925,
      "pose_mae_dx": 0.09496762603521347,
      "pose_mae_dy": 0.03295815736055374,
      "pose_rmse_dtheta": 0.33655795454978943,
      "pose_rmse_dx": 0.1953292042016983,
      "pose_rmse_dy": 0.07526291906833649,
      "pose_rmse_mean": 0.2023833692073822,
      "rmse_dtheta": 0.038134802132844925,
      "rmse_dx": 0.019965695217251778,
      "rmse_dy": 0.005559919402003288,
      "rmse_mean": 0.021220140159130096,
      "rotation_flip": 0.00909090880304575,
      "sparse_tokens": 5722.0,
      "step": 9041,
      "turn_loss": 0.20429906249046326,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4200892027504181,
      "grad_norm": 0.602703869342804,
      "learning_rate": 1.4541966154427823e-06,
      "loss": 0.1519,
      "mae_dtheta": 0.0070970566011965275,
      "mae_dx": 0.0018668685806915164,
      "mae_dy": 0.001550189801491797,
      "pose_mae_dtheta": 0.051864154636859894,
      "pose_mae_dx": 0.018118761479854584,
      "pose_mae_dy": 0.013102073222398758,
      "pose_rmse_dtheta": 0.18916532397270203,
      "pose_rmse_dx": 0.06458355486392975,
      "pose_rmse_dy": 0.042240530252456665,
      "pose_rmse_mean": 0.09866314381361008,
      "rmse_dtheta": 0.022793902084231377,
      "rmse_dx": 0.006771513260900974,
      "rmse_dy": 0.005575569812208414,
      "rmse_mean": 0.01171366311609745,
      "rotation_flip": 0.0041841003112494946,
      "sparse_tokens": 32121.0,
      "step": 9042,
      "turn_loss": 0.06194343790411949,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8116.0,
      "epoch": 0.42013566251626094,
      "grad_norm": 0.9252687096595764,
      "learning_rate": 1.453264512931748e-06,
      "loss": 0.1343,
      "mae_dtheta": 0.04165952652692795,
      "mae_dx": 0.011597421020269394,
      "mae_dy": 0.012462467886507511,
      "pose_mae_dtheta": 0.3256728947162628,
      "pose_mae_dx": 0.14158760011196136,
      "pose_mae_dy": 0.12683449685573578,
      "pose_rmse_dtheta": 0.4680330157279968,
      "pose_rmse_dx": 0.242125004529953,
      "pose_rmse_dy": 0.24214281141757965,
      "pose_rmse_mean": 0.31743359565734863,
      "rmse_dtheta": 0.05719131976366043,
      "rmse_dx": 0.021201463416218758,
      "rmse_dy": 0.023836495354771614,
      "rmse_mean": 0.034076426178216934,
      "rotation_flip": 0.023980814963579178,
      "sparse_tokens": 6965.0,
      "step": 9043,
      "turn_loss": 0.4919809103012085,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.4201821222821037,
      "grad_norm": 0.5029621720314026,
      "learning_rate": 1.4523326584458292e-06,
      "loss": 0.0933,
      "mae_dtheta": 0.039412640035152435,
      "mae_dx": 0.010646448470652103,
      "mae_dy": 0.0033193323761224747,
      "pose_mae_dtheta": 0.3315512239933014,
      "pose_mae_dx": 0.06707792729139328,
      "pose_mae_dy": 0.04076937213540077,
      "pose_rmse_dtheta": 0.5590968728065491,
      "pose_rmse_dx": 0.15312418341636658,
      "pose_rmse_dy": 0.1085779219865799,
      "pose_rmse_mean": 0.27359965443611145,
      "rmse_dtheta": 0.05855739861726761,
      "rmse_dx": 0.02147616818547249,
      "rmse_dy": 0.005864681676030159,
      "rmse_mean": 0.02863275073468685,
      "rotation_flip": 0.002358490601181984,
      "sparse_tokens": 6983.0,
      "step": 9044,
      "turn_loss": 0.22954021394252777,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4202285820479465,
      "grad_norm": 0.40343767404556274,
      "learning_rate": 1.4514010520501937e-06,
      "loss": 0.1035,
      "mae_dtheta": 0.013818351551890373,
      "mae_dx": 0.0018273101886734366,
      "mae_dy": 0.00234755827113986,
      "pose_mae_dtheta": 0.09350019693374634,
      "pose_mae_dx": 0.022036412730813026,
      "pose_mae_dy": 0.027387624606490135,
      "pose_rmse_dtheta": 0.2615584433078766,
      "pose_rmse_dx": 0.052346840500831604,
      "pose_rmse_dy": 0.056065626442432404,
      "pose_rmse_mean": 0.12332364171743393,
      "rmse_dtheta": 0.030303889885544777,
      "rmse_dx": 0.005252484697848558,
      "rmse_dy": 0.004773468244820833,
      "rmse_mean": 0.01344328187406063,
      "rotation_flip": 0.004857737571001053,
      "sparse_tokens": 32137.0,
      "step": 9045,
      "turn_loss": 0.10608327388763428,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4202750418137893,
      "grad_norm": 0.5266227126121521,
      "learning_rate": 1.450469693809986e-06,
      "loss": 0.1067,
      "mae_dtheta": 0.007914451882243156,
      "mae_dx": 0.001030287123285234,
      "mae_dy": 0.0013314622920006514,
      "pose_mae_dtheta": 0.047765448689460754,
      "pose_mae_dx": 0.011178378015756607,
      "pose_mae_dy": 0.015639640390872955,
      "pose_rmse_dtheta": 0.14036864042282104,
      "pose_rmse_dx": 0.028037630021572113,
      "pose_rmse_dy": 0.03770725056529045,
      "pose_rmse_mean": 0.0687045156955719,
      "rmse_dtheta": 0.019504021853208542,
      "rmse_dx": 0.0033667664974927902,
      "rmse_dy": 0.002997292671352625,
      "rmse_mean": 0.008622693829238415,
      "rotation_flip": 0.007494145072996616,
      "sparse_tokens": 32105.0,
      "step": 9046,
      "turn_loss": 0.06204831600189209,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.42032150157963205,
      "grad_norm": 0.8720858097076416,
      "learning_rate": 1.4495385837903386e-06,
      "loss": 0.1621,
      "mae_dtheta": 0.029055483639240265,
      "mae_dx": 0.00923911388963461,
      "mae_dy": 0.005585046950727701,
      "pose_mae_dtheta": 0.19674186408519745,
      "pose_mae_dx": 0.08636091649532318,
      "pose_mae_dy": 0.05614422634243965,
      "pose_rmse_dtheta": 0.35522323846817017,
      "pose_rmse_dx": 0.19117802381515503,
      "pose_rmse_dy": 0.10595802217721939,
      "pose_rmse_mean": 0.21745310723781586,
      "rmse_dtheta": 0.046258892863988876,
      "rmse_dx": 0.019585929811000824,
      "rmse_dy": 0.0109091242775321,
      "rmse_mean": 0.025584649294614792,
      "rotation_flip": 0.017576318234205246,
      "sparse_tokens": 17895.0,
      "step": 9047,
      "turn_loss": 0.24925434589385986,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.4203679613454748,
      "grad_norm": 0.5028701424598694,
      "learning_rate": 1.4486077220563627e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.03626397252082825,
      "mae_dx": 0.011355283670127392,
      "mae_dy": 0.006466692313551903,
      "pose_mae_dtheta": 0.2912697494029999,
      "pose_mae_dx": 0.09643395245075226,
      "pose_mae_dy": 0.07994810491800308,
      "pose_rmse_dtheta": 0.5191851854324341,
      "pose_rmse_dx": 0.20971518754959106,
      "pose_rmse_dy": 0.19825685024261475,
      "pose_rmse_mean": 0.30905240774154663,
      "rmse_dtheta": 0.05698636546730995,
      "rmse_dx": 0.02350648306310177,
      "rmse_dy": 0.013997946865856647,
      "rmse_mean": 0.031496934592723846,
      "rotation_flip": 0.014059754088521004,
      "sparse_tokens": 19983.0,
      "step": 9048,
      "turn_loss": 0.26248666644096375,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.4204144211113176,
      "grad_norm": 0.6976892352104187,
      "learning_rate": 1.4476771086731567e-06,
      "loss": 0.1265,
      "mae_dtheta": 0.03640648350119591,
      "mae_dx": 0.010507124476134777,
      "mae_dy": 0.005394069477915764,
      "pose_mae_dtheta": 0.3001197874546051,
      "pose_mae_dx": 0.09248558431863785,
      "pose_mae_dy": 0.06267102062702179,
      "pose_rmse_dtheta": 0.5670631527900696,
      "pose_rmse_dx": 0.19453555345535278,
      "pose_rmse_dy": 0.12311497330665588,
      "pose_rmse_mean": 0.29490455985069275,
      "rmse_dtheta": 0.057109612971544266,
      "rmse_dx": 0.021190324798226357,
      "rmse_dy": 0.00966233853250742,
      "rmse_mean": 0.02932075969874859,
      "rotation_flip": 0.002487562131136656,
      "sparse_tokens": 7573.0,
      "step": 9049,
      "turn_loss": 0.2121059149503708,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4204608808771604,
      "grad_norm": 0.39611828327178955,
      "learning_rate": 1.4467467437057964e-06,
      "loss": 0.0908,
      "mae_dtheta": 0.006768399383872747,
      "mae_dx": 0.0014011621242389083,
      "mae_dy": 0.0014280733885243535,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3961181640625,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.87127685546875,
      "model/head/act_norm_mean": 115.74947719381314,
      "model/head/act_norm_min": 57.81246566772461,
      "model/head/act_over_embed": 79.54412439126727,
      "model/head/grad_frac": 0.1043601930141449,
      "model/head/grad_norm": 0.0413389690220356,
      "model/head/grad_zero_frac": 0.000225580224650912,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7050288036616161,
      "model/head/update_ratio": 0.0007039394113235176,
      "model/head/weight_delta": 9.865885734558105,
      "model/head/weight_delta_rel": 0.17307685315608978,
      "model/head/weight_norm": 58.725181579589844,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4227014482021332,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42261728086428013,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4225389361381531,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904265520152541,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09799672663211823,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03881828486919403,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5379209474885844,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012534735724329948,
      "model/modality_embedder.encoders.pose/weight_delta": 3.132657289505005,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10235367715358734,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968570709228516,
      "model/modality_embedder/grad_frac": 0.09799672663211823,
      "model/modality_embedder/grad_norm": 0.03881828486919403,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5379209474885844,
      "model/modality_embedder/update_ratio": 0.0012534735724329948,
      "model/modality_embedder/weight_delta": 3.132657289505005,
      "model/modality_embedder/weight_delta_rel": 0.10235367715358734,
      "model/modality_embedder/weight_norm": 30.968570709228516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.00575256347656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.15688632355299,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.021355628967285,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.60083844187859,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05631634220480919,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.022307926788926125,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007982139359228313,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6800403594970703,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09766228497028351,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.947303771972656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.25347137451172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.13052398989899,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.105270385742188,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.269931361531007,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.056573063135147095,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02240961790084839,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007533042225986719,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.397615432739258,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11769605427980423,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.748430252075195,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.65721130371094,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.942157186948855,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.17464542388916,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.51490265532089,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05806252732872963,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02299962192773819,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007487222319468856,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.677539825439453,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12348490208387375,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.718496322631836,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.24402618408203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.6441673681257,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.158282279968262,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.684539986295984,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05627887323498726,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.022293083369731903,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007446682429872453,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1562745571136475,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10786648839712143,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.936933517456055,
      "model/normalizer/grad_frac": 0.19412438571453094,
      "model/normalizer/grad_norm": 0.07689619809389114,
      "model/normalizer/grad_zero_frac": 0.0002328024711459875,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.000977913266979158,
      "model/normalizer/weight_delta": 6.64830207824707,
      "model/normalizer/weight_delta_rel": 0.0856262817978859,
      "model/normalizer/weight_norm": 78.63294219970703,
      "pose_mae_dtheta": 0.047225672751665115,
      "pose_mae_dx": 0.015665629878640175,
      "pose_mae_dy": 0.0174492709338665,
      "pose_rmse_dtheta": 0.12730152904987335,
      "pose_rmse_dx": 0.040655266493558884,
      "pose_rmse_dy": 0.042494673281908035,
      "pose_rmse_mean": 0.07015049457550049,
      "rmse_dtheta": 0.01642267033457756,
      "rmse_dx": 0.005031921435147524,
      "rmse_dy": 0.0035593663342297077,
      "rmse_mean": 0.00833798572421074,
      "rotation_flip": 0.005042864475399256,
      "sparse_tokens": 32073.0,
      "step": 9050,
      "turn_loss": 0.05812488868832588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.42050734064300316,
      "grad_norm": 0.4040859639644623,
      "learning_rate": 1.4458166272193424e-06,
      "loss": 0.1054,
      "mae_dtheta": 0.005333830136805773,
      "mae_dx": 0.001145735033787787,
      "mae_dy": 0.0010223578428849578,
      "pose_mae_dtheta": 0.03344482555985451,
      "pose_mae_dx": 0.013645322993397713,
      "pose_mae_dy": 0.01207851804792881,
      "pose_rmse_dtheta": 0.12064468860626221,
      "pose_rmse_dx": 0.035992711782455444,
      "pose_rmse_dy": 0.03353244811296463,
      "pose_rmse_mean": 0.06338994950056076,
      "rmse_dtheta": 0.01786041259765625,
      "rmse_dx": 0.0031655547209084034,
      "rmse_dy": 0.002775502158328891,
      "rmse_mean": 0.007933823391795158,
      "rotation_flip": 0.002376425778493285,
      "sparse_tokens": 32153.0,
      "step": 9051,
      "turn_loss": 0.045815978199243546,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.42055380040884593,
      "grad_norm": 0.8028141260147095,
      "learning_rate": 1.4448867592788408e-06,
      "loss": 0.1875,
      "mae_dtheta": 0.03168534114956856,
      "mae_dx": 0.016444915905594826,
      "mae_dy": 0.005653875879943371,
      "pose_mae_dtheta": 0.23141910135746002,
      "pose_mae_dx": 0.14068454504013062,
      "pose_mae_dy": 0.06167818233370781,
      "pose_rmse_dtheta": 0.364004522562027,
      "pose_rmse_dx": 0.29395052790641785,
      "pose_rmse_dy": 0.13710707426071167,
      "pose_rmse_mean": 0.2650207281112671,
      "rmse_dtheta": 0.04632668197154999,
      "rmse_dx": 0.030153051018714905,
      "rmse_dy": 0.010911524295806885,
      "rmse_mean": 0.029130419716238976,
      "rotation_flip": 0.020070837810635567,
      "sparse_tokens": 15935.0,
      "step": 9052,
      "turn_loss": 0.35985711216926575,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.4206002601746887,
      "grad_norm": 0.5276629328727722,
      "learning_rate": 1.4439571399493146e-06,
      "loss": 0.1366,
      "mae_dtheta": 0.034304916858673096,
      "mae_dx": 0.008508442901074886,
      "mae_dy": 0.0050978586077690125,
      "pose_mae_dtheta": 0.24249044060707092,
      "pose_mae_dx": 0.067256398499012,
      "pose_mae_dy": 0.05916100740432739,
      "pose_rmse_dtheta": 0.44142836332321167,
      "pose_rmse_dx": 0.1385558545589447,
      "pose_rmse_dy": 0.14583300054073334,
      "pose_rmse_mean": 0.24193906784057617,
      "rmse_dtheta": 0.05229638144373894,
      "rmse_dx": 0.018808644264936447,
      "rmse_dy": 0.00915707740932703,
      "rmse_mean": 0.02675403468310833,
      "rotation_flip": 0.019329896196722984,
      "sparse_tokens": 13429.0,
      "step": 9053,
      "turn_loss": 0.26336392760276794,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4206467199405315,
      "grad_norm": 0.6331286430358887,
      "learning_rate": 1.443027769295776e-06,
      "loss": 0.1382,
      "mae_dtheta": 0.008909535594284534,
      "mae_dx": 0.0022185274865478277,
      "mae_dy": 0.0035046101547777653,
      "pose_mae_dtheta": 0.058732565492391586,
      "pose_mae_dx": 0.03336841240525246,
      "pose_mae_dy": 0.02902936190366745,
      "pose_rmse_dtheta": 0.14853157103061676,
      "pose_rmse_dx": 0.09794633835554123,
      "pose_rmse_dy": 0.06687470525503159,
      "pose_rmse_mean": 0.10445087403059006,
      "rmse_dtheta": 0.019769582897424698,
      "rmse_dx": 0.005834280047565699,
      "rmse_dy": 0.007884183898568153,
      "rmse_mean": 0.011162682436406612,
      "rotation_flip": 0.004437869880348444,
      "sparse_tokens": 32089.0,
      "step": 9054,
      "turn_loss": 0.08641555905342102,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.42069317970637427,
      "grad_norm": 0.5492187738418579,
      "learning_rate": 1.4420986473832127e-06,
      "loss": 0.1085,
      "mae_dtheta": 0.008591723628342152,
      "mae_dx": 0.0015390582848340273,
      "mae_dy": 0.002134565496817231,
      "pose_mae_dtheta": 0.05830593779683113,
      "pose_mae_dx": 0.017699899151921272,
      "pose_mae_dy": 0.023902691900730133,
      "pose_rmse_dtheta": 0.14628763496875763,
      "pose_rmse_dx": 0.049368005245923996,
      "pose_rmse_dy": 0.061822667717933655,
      "pose_rmse_mean": 0.0858260989189148,
      "rmse_dtheta": 0.01952192559838295,
      "rmse_dx": 0.005772891920059919,
      "rmse_dy": 0.0056962682865560055,
      "rmse_mean": 0.010330362245440483,
      "rotation_flip": 0.003285421058535576,
      "sparse_tokens": 32089.0,
      "step": 9055,
      "turn_loss": 0.08086274564266205,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.42073963947221704,
      "grad_norm": 0.9758689403533936,
      "learning_rate": 1.441169774276603e-06,
      "loss": 0.2059,
      "mae_dtheta": 0.0152635732665658,
      "mae_dx": 0.004880919121205807,
      "mae_dy": 0.006415542680770159,
      "pose_mae_dtheta": 0.12407693266868591,
      "pose_mae_dx": 0.05493728071451187,
      "pose_mae_dy": 0.057329531759023666,
      "pose_rmse_dtheta": 0.3353390693664551,
      "pose_rmse_dx": 0.16996031999588013,
      "pose_rmse_dy": 0.16191095113754272,
      "pose_rmse_mean": 0.22240345180034637,
      "rmse_dtheta": 0.03633208945393562,
      "rmse_dx": 0.013241419568657875,
      "rmse_dy": 0.016337411478161812,
      "rmse_mean": 0.02197030745446682,
      "rotation_flip": 0.007371007464826107,
      "sparse_tokens": 32057.0,
      "step": 9056,
      "turn_loss": 0.17692334949970245,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4207860992380598,
      "grad_norm": 0.6567776799201965,
      "learning_rate": 1.4402411500408985e-06,
      "loss": 0.0959,
      "mae_dtheta": 0.01304825022816658,
      "mae_dx": 0.002288498217239976,
      "mae_dy": 0.003241902217268944,
      "pose_mae_dtheta": 0.08340899646282196,
      "pose_mae_dx": 0.026875082403421402,
      "pose_mae_dy": 0.03505106270313263,
      "pose_rmse_dtheta": 0.2181556522846222,
      "pose_rmse_dx": 0.06905501335859299,
      "pose_rmse_dy": 0.08786062151193619,
      "pose_rmse_mean": 0.1250237673521042,
      "rmse_dtheta": 0.028505323454737663,
      "rmse_dx": 0.0069557856768369675,
      "rmse_dy": 0.007533662486821413,
      "rmse_mean": 0.014331590384244919,
      "rotation_flip": 0.007689350284636021,
      "sparse_tokens": 32089.0,
      "step": 9057,
      "turn_loss": 0.11713626980781555,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.4208325590039026,
      "grad_norm": 0.5159492492675781,
      "learning_rate": 1.439312774741042e-06,
      "loss": 0.124,
      "mae_dtheta": 0.02345316670835018,
      "mae_dx": 0.005407949909567833,
      "mae_dy": 0.004193135537207127,
      "pose_mae_dtheta": 0.1565873622894287,
      "pose_mae_dx": 0.051957082003355026,
      "pose_mae_dy": 0.05351708084344864,
      "pose_rmse_dtheta": 0.2770630121231079,
      "pose_rmse_dx": 0.1263773888349533,
      "pose_rmse_dy": 0.10610073059797287,
      "pose_rmse_mean": 0.1698470562696457,
      "rmse_dtheta": 0.03731270506978035,
      "rmse_dx": 0.014008082449436188,
      "rmse_dy": 0.008054771460592747,
      "rmse_mean": 0.019791852682828903,
      "rotation_flip": 0.01217038556933403,
      "sparse_tokens": 9014.0,
      "step": 9058,
      "turn_loss": 0.18744626641273499,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.4208790187697454,
      "grad_norm": 0.46774452924728394,
      "learning_rate": 1.438384648441955e-06,
      "loss": 0.0719,
      "mae_dtheta": 0.03563180938363075,
      "mae_dx": 0.011732781305909157,
      "mae_dy": 0.0033359567169100046,
      "pose_mae_dtheta": 0.26734912395477295,
      "pose_mae_dx": 0.08748257905244827,
      "pose_mae_dy": 0.03204869106411934,
      "pose_rmse_dtheta": 0.4798052906990051,
      "pose_rmse_dx": 0.2258475124835968,
      "pose_rmse_dy": 0.06566773355007172,
      "pose_rmse_mean": 0.25710687041282654,
      "rmse_dtheta": 0.05584945157170296,
      "rmse_dx": 0.024495406076312065,
      "rmse_dy": 0.006332394201308489,
      "rmse_mean": 0.02889241836965084,
      "rotation_flip": 0.007751937955617905,
      "sparse_tokens": 4955.0,
      "step": 9059,
      "turn_loss": 0.25917065143585205,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 8465.0,
      "epoch": 0.4209254785355882,
      "grad_norm": 0.4876023232936859,
      "learning_rate": 1.4374567712085401e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.033572230488061905,
      "mae_dx": 0.00968053936958313,
      "mae_dy": 0.004071617964655161,
      "pose_mae_dtheta": 0.2757054269313812,
      "pose_mae_dx": 0.0885777547955513,
      "pose_mae_dy": 0.06794402003288269,
      "pose_rmse_dtheta": 0.46679195761680603,
      "pose_rmse_dx": 0.1965237259864807,
      "pose_rmse_dy": 0.15878932178020477,
      "pose_rmse_mean": 0.2740350067615509,
      "rmse_dtheta": 0.05051339045166969,
      "rmse_dx": 0.021639779210090637,
      "rmse_dy": 0.007777946535497904,
      "rmse_mean": 0.026643704622983932,
      "rotation_flip": 0.011135857552289963,
      "sparse_tokens": 6972.0,
      "step": 9060,
      "turn_loss": 0.18866416811943054,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.420971938301431,
      "grad_norm": 0.4683806598186493,
      "learning_rate": 1.4365291431056871e-06,
      "loss": 0.1259,
      "mae_dtheta": 0.010019203647971153,
      "mae_dx": 0.0017464638222008944,
      "mae_dy": 0.0024222792126238346,
      "pose_mae_dtheta": 0.06643999367952347,
      "pose_mae_dx": 0.021393897011876106,
      "pose_mae_dy": 0.02407311275601387,
      "pose_rmse_dtheta": 0.17564241588115692,
      "pose_rmse_dx": 0.062060534954071045,
      "pose_rmse_dy": 0.07130488008260727,
      "pose_rmse_mean": 0.10300260782241821,
      "rmse_dtheta": 0.02332868054509163,
      "rmse_dx": 0.005674706306308508,
      "rmse_dy": 0.006985953543335199,
      "rmse_mean": 0.01199644710868597,
      "rotation_flip": 0.011430824175477028,
      "sparse_tokens": 32121.0,
      "step": 9061,
      "turn_loss": 0.08716151863336563,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.42101839806727376,
      "grad_norm": 0.5398330092430115,
      "learning_rate": 1.4356017641982617e-06,
      "loss": 0.0921,
      "mae_dtheta": 0.010732119902968407,
      "mae_dx": 0.002921300707384944,
      "mae_dy": 0.0036490196362137794,
      "pose_mae_dtheta": 0.06964944303035736,
      "pose_mae_dx": 0.0382545068860054,
      "pose_mae_dy": 0.03680893033742905,
      "pose_rmse_dtheta": 0.1419166475534439,
      "pose_rmse_dx": 0.13345617055892944,
      "pose_rmse_dy": 0.0968051329255104,
      "pose_rmse_mean": 0.12405931204557419,
      "rmse_dtheta": 0.020866064354777336,
      "rmse_dx": 0.01097902748733759,
      "rmse_dy": 0.009287608787417412,
      "rmse_mean": 0.013710901141166687,
      "rotation_flip": 0.004315417725592852,
      "sparse_tokens": 32073.0,
      "step": 9062,
      "turn_loss": 0.10859749466180801,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17481.0,
      "epoch": 0.42106485783311653,
      "grad_norm": 0.9331074357032776,
      "learning_rate": 1.434674634551118e-06,
      "loss": 0.259,
      "mae_dtheta": 0.037577781826257706,
      "mae_dx": 0.020808635279536247,
      "mae_dy": 0.005371135659515858,
      "pose_mae_dtheta": 0.30924877524375916,
      "pose_mae_dx": 0.16580215096473694,
      "pose_mae_dy": 0.07016599178314209,
      "pose_rmse_dtheta": 0.5024703145027161,
      "pose_rmse_dx": 0.3199262022972107,
      "pose_rmse_dy": 0.14648501574993134,
      "pose_rmse_mean": 0.3229605257511139,
      "rmse_dtheta": 0.05351080745458603,
      "rmse_dx": 0.035032495856285095,
      "rmse_dy": 0.009765658527612686,
      "rmse_mean": 0.03276965767145157,
      "rotation_flip": 0.015075377188622952,
      "sparse_tokens": 14105.0,
      "step": 9063,
      "turn_loss": 0.39930272102355957,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.4211113175989593,
      "grad_norm": 0.4699038565158844,
      "learning_rate": 1.433747754229093e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.03154154121875763,
      "mae_dx": 0.009376667439937592,
      "mae_dy": 0.004243145696818829,
      "pose_mae_dtheta": 0.24435614049434662,
      "pose_mae_dx": 0.07361507415771484,
      "pose_mae_dy": 0.052563607692718506,
      "pose_rmse_dtheta": 0.4511820673942566,
      "pose_rmse_dx": 0.16770783066749573,
      "pose_rmse_dy": 0.1199597492814064,
      "pose_rmse_mean": 0.24628323316574097,
      "rmse_dtheta": 0.049875110387802124,
      "rmse_dx": 0.020530547946691513,
      "rmse_dy": 0.009391053579747677,
      "rmse_mean": 0.02659890614449978,
      "rotation_flip": 0.013036809861660004,
      "sparse_tokens": 20152.0,
      "step": 9064,
      "turn_loss": 0.2640810012817383,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4211577773648021,
      "grad_norm": 0.3205450773239136,
      "learning_rate": 1.4328211232969995e-06,
      "loss": 0.0836,
      "mae_dtheta": 0.011134900152683258,
      "mae_dx": 0.0014899608213454485,
      "mae_dy": 0.0021748924627900124,
      "pose_mae_dtheta": 0.072663314640522,
      "pose_mae_dx": 0.022259438410401344,
      "pose_mae_dy": 0.03296758234500885,
      "pose_rmse_dtheta": 0.14396926760673523,
      "pose_rmse_dx": 0.0527820810675621,
      "pose_rmse_dy": 0.06430858373641968,
      "pose_rmse_mean": 0.08701997995376587,
      "rmse_dtheta": 0.020878398790955544,
      "rmse_dx": 0.005210464354604483,
      "rmse_dy": 0.0038272938691079617,
      "rmse_mean": 0.00997205264866352,
      "rotation_flip": 0.004194337874650955,
      "sparse_tokens": 32089.0,
      "step": 9065,
      "turn_loss": 0.08719837665557861,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.42120423713064487,
      "grad_norm": 0.34708794951438904,
      "learning_rate": 1.431894741819641e-06,
      "loss": 0.0872,
      "mae_dtheta": 0.011419259011745453,
      "mae_dx": 0.0019293848890811205,
      "mae_dy": 0.0029478014912456274,
      "pose_mae_dtheta": 0.08065030723810196,
      "pose_mae_dx": 0.028609713539481163,
      "pose_mae_dy": 0.03237304463982582,
      "pose_rmse_dtheta": 0.1790713369846344,
      "pose_rmse_dx": 0.06388348340988159,
      "pose_rmse_dy": 0.06261827796697617,
      "pose_rmse_mean": 0.10185770690441132,
      "rmse_dtheta": 0.0230553075671196,
      "rmse_dx": 0.005097820423543453,
      "rmse_dy": 0.0054496037773787975,
      "rmse_mean": 0.011200911365449429,
      "rotation_flip": 0.004691688809543848,
      "sparse_tokens": 32089.0,
      "step": 9066,
      "turn_loss": 0.10808516293764114,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.42125069689648764,
      "grad_norm": 0.5493068695068359,
      "learning_rate": 1.4309686098617975e-06,
      "loss": 0.1338,
      "mae_dtheta": 0.013138381764292717,
      "mae_dx": 0.0012788446620106697,
      "mae_dy": 0.002591604134067893,
      "pose_mae_dtheta": 0.09369337558746338,
      "pose_mae_dx": 0.02045820839703083,
      "pose_mae_dy": 0.034433625638484955,
      "pose_rmse_dtheta": 0.22851920127868652,
      "pose_rmse_dx": 0.046043962240219116,
      "pose_rmse_dy": 0.07384447753429413,
      "pose_rmse_mean": 0.11613588035106659,
      "rmse_dtheta": 0.02553429827094078,
      "rmse_dx": 0.003932024817913771,
      "rmse_dy": 0.00465068593621254,
      "rmse_mean": 0.011372337117791176,
      "rotation_flip": 0.003253090428188443,
      "sparse_tokens": 32089.0,
      "step": 9067,
      "turn_loss": 0.08812818676233292,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.4212971566623304,
      "grad_norm": 0.5547705292701721,
      "learning_rate": 1.4300427274882357e-06,
      "loss": 0.1664,
      "mae_dtheta": 0.02496274933218956,
      "mae_dx": 0.009140168316662312,
      "mae_dy": 0.004617191385477781,
      "pose_mae_dtheta": 0.2011261284351349,
      "pose_mae_dx": 0.07236910611391068,
      "pose_mae_dy": 0.06892614811658859,
      "pose_rmse_dtheta": 0.3771129250526428,
      "pose_rmse_dx": 0.15708300471305847,
      "pose_rmse_dy": 0.14834773540496826,
      "pose_rmse_mean": 0.22751455008983612,
      "rmse_dtheta": 0.04111342504620552,
      "rmse_dx": 0.02076338417828083,
      "rmse_dy": 0.007764284033328295,
      "rmse_mean": 0.023213699460029602,
      "rotation_flip": 0.013927577063441277,
      "sparse_tokens": 20893.0,
      "step": 9068,
      "turn_loss": 0.22818569839000702,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.4213436164281732,
      "grad_norm": 0.4418008029460907,
      "learning_rate": 1.4291170947637005e-06,
      "loss": 0.1016,
      "mae_dtheta": 0.029719682410359383,
      "mae_dx": 0.010462027043104172,
      "mae_dy": 0.0019557925406843424,
      "pose_mae_dtheta": 0.20676203072071075,
      "pose_mae_dx": 0.08542350679636002,
      "pose_mae_dy": 0.030867261812090874,
      "pose_rmse_dtheta": 0.3681071996688843,
      "pose_rmse_dx": 0.20424596965312958,
      "pose_rmse_dy": 0.06999475508928299,
      "pose_rmse_mean": 0.21411597728729248,
      "rmse_dtheta": 0.047831155359745026,
      "rmse_dx": 0.02217789925634861,
      "rmse_dy": 0.004152096342295408,
      "rmse_mean": 0.024720383808016777,
      "rotation_flip": 0.018912529572844505,
      "sparse_tokens": 7684.0,
      "step": 9069,
      "turn_loss": 0.27320149540901184,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.421390076194016,
      "grad_norm": 0.421374648809433,
      "learning_rate": 1.4281917117529236e-06,
      "loss": 0.1057,
      "mae_dtheta": 0.009997740387916565,
      "mae_dx": 0.0014913016930222511,
      "mae_dy": 0.002926614135503769,
      "pose_mae_dtheta": 0.05988185852766037,
      "pose_mae_dx": 0.023529967293143272,
      "pose_mae_dy": 0.0327504500746727,
      "pose_rmse_dtheta": 0.11453067511320114,
      "pose_rmse_dx": 0.06148303672671318,
      "pose_rmse_dy": 0.07362569868564606,
      "pose_rmse_mean": 0.08321313560009003,
      "rmse_dtheta": 0.018816974014043808,
      "rmse_dx": 0.004088666755706072,
      "rmse_dy": 0.0062050847336649895,
      "rmse_mean": 0.009703575633466244,
      "rotation_flip": 0.0071151359006762505,
      "sparse_tokens": 32121.0,
      "step": 9070,
      "turn_loss": 0.08630184084177017,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.42143653595985875,
      "grad_norm": 0.3945881426334381,
      "learning_rate": 1.427266578520619e-06,
      "loss": 0.1236,
      "mae_dtheta": 0.03402817249298096,
      "mae_dx": 0.012774921953678131,
      "mae_dy": 0.00741176214069128,
      "pose_mae_dtheta": 0.2697056233882904,
      "pose_mae_dx": 0.09723813831806183,
      "pose_mae_dy": 0.07480192184448242,
      "pose_rmse_dtheta": 0.4554593563079834,
      "pose_rmse_dx": 0.22076654434204102,
      "pose_rmse_dy": 0.19259078800678253,
      "pose_rmse_mean": 0.2896055579185486,
      "rmse_dtheta": 0.05218283459544182,
      "rmse_dx": 0.024911466985940933,
      "rmse_dy": 0.015610406175255775,
      "rmse_mean": 0.03090156987309456,
      "rotation_flip": 0.007929515093564987,
      "sparse_tokens": 18203.0,
      "step": 9071,
      "turn_loss": 0.2913793623447418,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.4214829957257015,
      "grad_norm": 0.5386761426925659,
      "learning_rate": 1.4263416951314785e-06,
      "loss": 0.1172,
      "mae_dtheta": 0.03249193727970123,
      "mae_dx": 0.011179875582456589,
      "mae_dy": 0.004980466328561306,
      "pose_mae_dtheta": 0.240505188703537,
      "pose_mae_dx": 0.09650905430316925,
      "pose_mae_dy": 0.054306503385305405,
      "pose_rmse_dtheta": 0.4331459701061249,
      "pose_rmse_dx": 0.2147272378206253,
      "pose_rmse_dy": 0.11366458982229233,
      "pose_rmse_mean": 0.2538459300994873,
      "rmse_dtheta": 0.05093082785606384,
      "rmse_dx": 0.0234980545938015,
      "rmse_dy": 0.008494221605360508,
      "rmse_mean": 0.027641035616397858,
      "rotation_flip": 0.008991008624434471,
      "sparse_tokens": 17934.0,
      "step": 9072,
      "turn_loss": 0.28972819447517395,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4215294554915443,
      "grad_norm": 0.6091973781585693,
      "learning_rate": 1.4254170616501828e-06,
      "loss": 0.126,
      "mae_dtheta": 0.008746408857405186,
      "mae_dx": 0.0023865094408392906,
      "mae_dy": 0.002000659005716443,
      "pose_mae_dtheta": 0.06402606517076492,
      "pose_mae_dx": 0.025027867406606674,
      "pose_mae_dy": 0.025003395974636078,
      "pose_rmse_dtheta": 0.16106587648391724,
      "pose_rmse_dx": 0.0818728357553482,
      "pose_rmse_dy": 0.0663878470659256,
      "pose_rmse_mean": 0.10310885310173035,
      "rmse_dtheta": 0.021344834938645363,
      "rmse_dx": 0.008530150167644024,
      "rmse_dy": 0.004903447814285755,
      "rmse_mean": 0.011592810973525047,
      "rotation_flip": 0.001987084047868848,
      "sparse_tokens": 32121.0,
      "step": 9073,
      "turn_loss": 0.07897495478391647,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.4215759152573871,
      "grad_norm": 0.481431782245636,
      "learning_rate": 1.4244926781413893e-06,
      "loss": 0.1281,
      "mae_dtheta": 0.03328412398695946,
      "mae_dx": 0.011605767533183098,
      "mae_dy": 0.004567095078527927,
      "pose_mae_dtheta": 0.2563636302947998,
      "pose_mae_dx": 0.09021639078855515,
      "pose_mae_dy": 0.0640440434217453,
      "pose_rmse_dtheta": 0.4738273322582245,
      "pose_rmse_dx": 0.21813979744911194,
      "pose_rmse_dy": 0.15600140392780304,
      "pose_rmse_mean": 0.282656192779541,
      "rmse_dtheta": 0.050836287438869476,
      "rmse_dx": 0.02518526092171669,
      "rmse_dy": 0.008303027600049973,
      "rmse_mean": 0.02810819447040558,
      "rotation_flip": 0.011637573130428791,
      "sparse_tokens": 19960.0,
      "step": 9074,
      "turn_loss": 0.2643173933029175,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.42162237502322986,
      "grad_norm": 0.38302233815193176,
      "learning_rate": 1.4235685446697433e-06,
      "loss": 0.0699,
      "mae_dtheta": 0.006893490441143513,
      "mae_dx": 0.0013004620559513569,
      "mae_dy": 0.0010148504516109824,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3830223083496094,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.51792907714844,
      "model/head/act_norm_mean": 120.46018781565657,
      "model/head/act_norm_min": 58.29411697387695,
      "model/head/act_over_embed": 82.78136883296577,
      "model/head/grad_frac": 0.08095909655094147,
      "model/head/grad_norm": 0.031009139493107796,
      "model/head/grad_zero_frac": 0.00019036306184716523,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7000473484848485,
      "model/head/update_ratio": 0.000528034579474479,
      "model/head/weight_delta": 9.868867874145508,
      "model/head/weight_delta_rel": 0.17312917113304138,
      "model/head/weight_norm": 58.7255859375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4226735234260559,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4226023356119792,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4225448668003082,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29041628149795323,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10304006934165955,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03946664556860924,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5377519615800865,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001274408190511167,
      "model/modality_embedder.encoders.pose/weight_delta": 3.133840799331665,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10239234566688538,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968605041503906,
      "model/modality_embedder/grad_frac": 0.10304006934165955,
      "model/modality_embedder/grad_norm": 0.03946664556860924,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5377519615800865,
      "model/modality_embedder/update_ratio": 0.001274408190511167,
      "model/modality_embedder/weight_delta": 3.133840799331665,
      "model/modality_embedder/weight_delta_rel": 0.10239234566688538,
      "model/modality_embedder/weight_norm": 30.968605041503906,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.14331817626953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.670582311207312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.973688125610352,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.953855133892247,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05473361164331436,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02096419408917427,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007501262007281184,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.681675672531128,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0977218821644783,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.947555541992188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.85343933105469,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.713566718775052,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.305646896362305,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.670603783346667,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05467121675610542,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.020940296351909637,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007039004703983665,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.3995893001556396,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1177644282579422,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.748945236206055,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.8804702758789,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.546847442680775,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.265185356140137,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.93045146025923,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05621933564543724,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.021533260121941566,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007009729743003845,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.679793357849121,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12356057018041611,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.71910285949707,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.64561462402344,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.20599847683181,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.112135887145996,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.070635584144533,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.059354208409786224,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.022733986377716064,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007593866321258247,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1584718227386475,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10794157534837723,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.937301635742188,
      "model/normalizer/grad_frac": 0.2180163860321045,
      "model/normalizer/grad_norm": 0.08350513875484467,
      "model/normalizer/grad_zero_frac": 0.00020325901277828962,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010619539534673095,
      "model/normalizer/weight_delta": 6.6524505615234375,
      "model/normalizer/weight_delta_rel": 0.08567970991134644,
      "model/normalizer/weight_norm": 78.63348388671875,
      "pose_mae_dtheta": 0.05129018798470497,
      "pose_mae_dx": 0.012357492931187153,
      "pose_mae_dy": 0.013076720759272575,
      "pose_rmse_dtheta": 0.18822209537029266,
      "pose_rmse_dx": 0.03264177218079567,
      "pose_rmse_dy": 0.03343728557229042,
      "pose_rmse_mean": 0.08476705849170685,
      "rmse_dtheta": 0.021450810134410858,
      "rmse_dx": 0.004182643257081509,
      "rmse_dy": 0.0024595765862613916,
      "rmse_mean": 0.00936434417963028,
      "rotation_flip": 0.0036003601271659136,
      "sparse_tokens": 32169.0,
      "step": 9075,
      "turn_loss": 0.05389401316642761,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4216688347890727,
      "grad_norm": 0.3693024516105652,
      "learning_rate": 1.4226446612998673e-06,
      "loss": 0.0629,
      "mae_dtheta": 0.006658610422164202,
      "mae_dx": 0.0012992987176403403,
      "mae_dy": 0.0006153190624900162,
      "pose_mae_dtheta": 0.04725812003016472,
      "pose_mae_dx": 0.01201934926211834,
      "pose_mae_dy": 0.008534836582839489,
      "pose_rmse_dtheta": 0.19581039249897003,
      "pose_rmse_dx": 0.037052519619464874,
      "pose_rmse_dy": 0.03413316234946251,
      "pose_rmse_mean": 0.0889986976981163,
      "rmse_dtheta": 0.02360673062503338,
      "rmse_dx": 0.004137421492487192,
      "rmse_dy": 0.002086635446175933,
      "rmse_mean": 0.009943596087396145,
      "rotation_flip": 0.001923076924867928,
      "sparse_tokens": 32169.0,
      "step": 9076,
      "turn_loss": 0.03829331696033478,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.42171529455491547,
      "grad_norm": 0.3365234136581421,
      "learning_rate": 1.42172102809637e-06,
      "loss": 0.0829,
      "mae_dtheta": 0.033010613173246384,
      "mae_dx": 0.00833063293248415,
      "mae_dy": 0.004768082872033119,
      "pose_mae_dtheta": 0.24753431975841522,
      "pose_mae_dx": 0.07572831213474274,
      "pose_mae_dy": 0.06388292461633682,
      "pose_rmse_dtheta": 0.4914909601211548,
      "pose_rmse_dx": 0.177260622382164,
      "pose_rmse_dy": 0.1634536236524582,
      "pose_rmse_mean": 0.27740174531936646,
      "rmse_dtheta": 0.053318850696086884,
      "rmse_dx": 0.019265402108430862,
      "rmse_dy": 0.009548855945467949,
      "rmse_mean": 0.02737770602107048,
      "rotation_flip": 0.0045045046135783195,
      "sparse_tokens": 10494.0,
      "step": 9077,
      "turn_loss": 0.24397650361061096,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.42176175432075824,
      "grad_norm": 1.0619144439697266,
      "learning_rate": 1.420797645123843e-06,
      "loss": 0.1738,
      "mae_dtheta": 0.02357775717973709,
      "mae_dx": 0.00932591687887907,
      "mae_dy": 0.004497472662478685,
      "pose_mae_dtheta": 0.17785771191120148,
      "pose_mae_dx": 0.08138193190097809,
      "pose_mae_dy": 0.057900093495845795,
      "pose_rmse_dtheta": 0.3405798375606537,
      "pose_rmse_dx": 0.21052603423595428,
      "pose_rmse_dy": 0.1330224722623825,
      "pose_rmse_mean": 0.22804278135299683,
      "rmse_dtheta": 0.03993169218301773,
      "rmse_dx": 0.021836843341588974,
      "rmse_dy": 0.009222645312547684,
      "rmse_mean": 0.023663727566599846,
      "rotation_flip": 0.00917431153357029,
      "sparse_tokens": 11132.0,
      "step": 9078,
      "turn_loss": 0.1903151571750641,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.421808214086601,
      "grad_norm": 0.3437356948852539,
      "learning_rate": 1.4198745124468565e-06,
      "loss": 0.056,
      "mae_dtheta": 0.004571056924760342,
      "mae_dx": 0.0009136424050666392,
      "mae_dy": 0.0004906065296381712,
      "pose_mae_dtheta": 0.033516786992549896,
      "pose_mae_dx": 0.007893412373960018,
      "pose_mae_dy": 0.008421649225056171,
      "pose_rmse_dtheta": 0.14078421890735626,
      "pose_rmse_dx": 0.031181884929537773,
      "pose_rmse_dy": 0.02872929908335209,
      "pose_rmse_mean": 0.06689847260713577,
      "rmse_dtheta": 0.017604347318410873,
      "rmse_dx": 0.004139297641813755,
      "rmse_dy": 0.0013615126954391599,
      "rmse_mean": 0.007701719179749489,
      "rotation_flip": 0.0,
      "sparse_tokens": 32057.0,
      "step": 9079,
      "turn_loss": 0.026341339573264122,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 38938.0,
      "epoch": 0.4218546738524438,
      "grad_norm": 0.406802237033844,
      "learning_rate": 1.418951630129969e-06,
      "loss": 0.1131,
      "mae_dtheta": 0.03409881517291069,
      "mae_dx": 0.010143119841814041,
      "mae_dy": 0.0036170566454529762,
      "pose_mae_dtheta": 0.26212844252586365,
      "pose_mae_dx": 0.07743065804243088,
      "pose_mae_dy": 0.04446619376540184,
      "pose_rmse_dtheta": 0.5003380179405212,
      "pose_rmse_dx": 0.17897877097129822,
      "pose_rmse_dy": 0.12310492247343063,
      "pose_rmse_mean": 0.26747390627861023,
      "rmse_dtheta": 0.05522283539175987,
      "rmse_dx": 0.021706558763980865,
      "rmse_dy": 0.007523845415562391,
      "rmse_mean": 0.028151078149676323,
      "rotation_flip": 0.0144258514046669,
      "sparse_tokens": 29617.0,
      "step": 9080,
      "turn_loss": 0.22800157964229584,
      "turns": 120.0,
      "turns_per_sample": 120.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4219011336182866,
      "grad_norm": 0.39923807978630066,
      "learning_rate": 1.4180289982377138e-06,
      "loss": 0.1088,
      "mae_dtheta": 0.012416508048772812,
      "mae_dx": 0.003412730060517788,
      "mae_dy": 0.004259331151843071,
      "pose_mae_dtheta": 0.08439454436302185,
      "pose_mae_dx": 0.034517016261816025,
      "pose_mae_dy": 0.0411650575697422,
      "pose_rmse_dtheta": 0.22719231247901917,
      "pose_rmse_dx": 0.09741954505443573,
      "pose_rmse_dy": 0.14100399613380432,
      "pose_rmse_mean": 0.15520527958869934,
      "rmse_dtheta": 0.027869243174791336,
      "rmse_dx": 0.012782580219209194,
      "rmse_dy": 0.012777280062437057,
      "rmse_mean": 0.017809702083468437,
      "rotation_flip": 0.0023382697254419327,
      "sparse_tokens": 32089.0,
      "step": 9081,
      "turn_loss": 0.12229863554239273,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.42194759338412935,
      "grad_norm": 0.4562065005302429,
      "learning_rate": 1.4171066168346138e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.03863952308893204,
      "mae_dx": 0.014367525465786457,
      "mae_dy": 0.005911671090871096,
      "pose_mae_dtheta": 0.32737699151039124,
      "pose_mae_dx": 0.10096239298582077,
      "pose_mae_dy": 0.05842085927724838,
      "pose_rmse_dtheta": 0.548343300819397,
      "pose_rmse_dx": 0.22673705220222473,
      "pose_rmse_dy": 0.12928476929664612,
      "pose_rmse_mean": 0.301455020904541,
      "rmse_dtheta": 0.05523582175374031,
      "rmse_dx": 0.027376854792237282,
      "rmse_dy": 0.013153049163520336,
      "rmse_mean": 0.031921908259391785,
      "rotation_flip": 0.009140768088400364,
      "sparse_tokens": 17976.0,
      "step": 9082,
      "turn_loss": 0.30638188123703003,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4219940531499721,
      "grad_norm": 0.4015224874019623,
      "learning_rate": 1.416184485985172e-06,
      "loss": 0.0721,
      "mae_dtheta": 0.010177168995141983,
      "mae_dx": 0.001269685453735292,
      "mae_dy": 0.002279511420056224,
      "pose_mae_dtheta": 0.06347905099391937,
      "pose_mae_dx": 0.019960306584835052,
      "pose_mae_dy": 0.02716577984392643,
      "pose_rmse_dtheta": 0.15427087247371674,
      "pose_rmse_dx": 0.04870614781975746,
      "pose_rmse_dy": 0.07185930758714676,
      "pose_rmse_mean": 0.09161211550235748,
      "rmse_dtheta": 0.021596062928438187,
      "rmse_dx": 0.003595910966396332,
      "rmse_dy": 0.0048738266341388226,
      "rmse_mean": 0.010021934285759926,
      "rotation_flip": 0.005647590383887291,
      "sparse_tokens": 32073.0,
      "step": 9083,
      "turn_loss": 0.0712699145078659,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4220405129158149,
      "grad_norm": 0.48610183596611023,
      "learning_rate": 1.4152626057538716e-06,
      "loss": 0.11,
      "mae_dtheta": 0.004140091594308615,
      "mae_dx": 0.0007078555063344538,
      "mae_dy": 0.0008839964284561574,
      "pose_mae_dtheta": 0.027862081304192543,
      "pose_mae_dx": 0.009366118349134922,
      "pose_mae_dy": 0.013350262306630611,
      "pose_rmse_dtheta": 0.06979317963123322,
      "pose_rmse_dx": 0.025707559660077095,
      "pose_rmse_dy": 0.0356239378452301,
      "pose_rmse_mean": 0.04370822757482529,
      "rmse_dtheta": 0.010378335602581501,
      "rmse_dx": 0.0021505465265363455,
      "rmse_dy": 0.002012421377003193,
      "rmse_mean": 0.004847101401537657,
      "rotation_flip": 0.0015781167894601822,
      "sparse_tokens": 32073.0,
      "step": 9084,
      "turn_loss": 0.03490787744522095,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4220869726816577,
      "grad_norm": 0.4733468294143677,
      "learning_rate": 1.4143409762051829e-06,
      "loss": 0.1192,
      "mae_dtheta": 0.007602765690535307,
      "mae_dx": 0.0010066217510029674,
      "mae_dy": 0.0001673379010753706,
      "pose_mae_dtheta": 0.049555454403162,
      "pose_mae_dx": 0.007666729390621185,
      "pose_mae_dy": 0.00225321133621037,
      "pose_rmse_dtheta": 0.23684431612491608,
      "pose_rmse_dx": 0.019035208970308304,
      "pose_rmse_dy": 0.004063417203724384,
      "pose_rmse_mean": 0.0866476520895958,
      "rmse_dtheta": 0.030579451471567154,
      "rmse_dx": 0.002960152691230178,
      "rmse_dy": 0.00032741486211307347,
      "rmse_mean": 0.011289007030427456,
      "rotation_flip": 0.0006600660271942616,
      "sparse_tokens": 32185.0,
      "step": 9085,
      "turn_loss": 0.03762561455368996,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.42213343244750046,
      "grad_norm": 1.1705083847045898,
      "learning_rate": 1.4134195974035525e-06,
      "loss": 0.2488,
      "mae_dtheta": 0.022338131442666054,
      "mae_dx": 0.007506643421947956,
      "mae_dy": 0.007672613952308893,
      "pose_mae_dtheta": 0.17590530216693878,
      "pose_mae_dx": 0.07335607707500458,
      "pose_mae_dy": 0.08551526814699173,
      "pose_rmse_dtheta": 0.36932092905044556,
      "pose_rmse_dx": 0.18712572753429413,
      "pose_rmse_dy": 0.21943943202495575,
      "pose_rmse_mean": 0.2586287260055542,
      "rmse_dtheta": 0.040657609701156616,
      "rmse_dx": 0.017539482563734055,
      "rmse_dy": 0.018342141062021255,
      "rmse_mean": 0.02551307901740074,
      "rotation_flip": 0.010989011265337467,
      "sparse_tokens": 16837.0,
      "step": 9086,
      "turn_loss": 0.2603294253349304,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.42217989221334323,
      "grad_norm": 0.483971506357193,
      "learning_rate": 1.4124984694134163e-06,
      "loss": 0.1008,
      "mae_dtheta": 0.008817850612103939,
      "mae_dx": 0.0013722258154302835,
      "mae_dy": 0.001550201210193336,
      "pose_mae_dtheta": 0.060345686972141266,
      "pose_mae_dx": 0.014757732860744,
      "pose_mae_dy": 0.016945678740739822,
      "pose_rmse_dtheta": 0.17955920100212097,
      "pose_rmse_dx": 0.03433695062994957,
      "pose_rmse_dy": 0.04187113791704178,
      "pose_rmse_mean": 0.08525576442480087,
      "rmse_dtheta": 0.02342407964169979,
      "rmse_dx": 0.003981930669397116,
      "rmse_dy": 0.0037349245976656675,
      "rmse_mean": 0.010380311869084835,
      "rotation_flip": 0.004937163554131985,
      "sparse_tokens": 32137.0,
      "step": 9087,
      "turn_loss": 0.06712256371974945,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.422226351979186,
      "grad_norm": 0.4965643286705017,
      "learning_rate": 1.4115775922991875e-06,
      "loss": 0.125,
      "mae_dtheta": 0.03481278941035271,
      "mae_dx": 0.010710201226174831,
      "mae_dy": 0.0056215208023786545,
      "pose_mae_dtheta": 0.2772271931171417,
      "pose_mae_dx": 0.08747544139623642,
      "pose_mae_dy": 0.05789642408490181,
      "pose_rmse_dtheta": 0.4821825623512268,
      "pose_rmse_dx": 0.18571831285953522,
      "pose_rmse_dy": 0.11852454394102097,
      "pose_rmse_mean": 0.2621418237686157,
      "rmse_dtheta": 0.052738625556230545,
      "rmse_dx": 0.021141160279512405,
      "rmse_dy": 0.0109019223600626,
      "rmse_mean": 0.028260570019483566,
      "rotation_flip": 0.018707482144236565,
      "sparse_tokens": 10510.0,
      "step": 9088,
      "turn_loss": 0.2994201183319092,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4222728117450288,
      "grad_norm": 0.5042982697486877,
      "learning_rate": 1.4106569661252623e-06,
      "loss": 0.1443,
      "mae_dtheta": 0.008277528919279575,
      "mae_dx": 0.0017212553648278117,
      "mae_dy": 0.002115490147843957,
      "pose_mae_dtheta": 0.056195229291915894,
      "pose_mae_dx": 0.016058428213000298,
      "pose_mae_dy": 0.021950501948595047,
      "pose_rmse_dtheta": 0.15488691627979279,
      "pose_rmse_dx": 0.04603663459420204,
      "pose_rmse_dy": 0.05000884085893631,
      "pose_rmse_mean": 0.08364413678646088,
      "rmse_dtheta": 0.02027515508234501,
      "rmse_dx": 0.007343938574194908,
      "rmse_dy": 0.0063064731657505035,
      "rmse_mean": 0.011308522894978523,
      "rotation_flip": 0.0021240441128611565,
      "sparse_tokens": 32105.0,
      "step": 9089,
      "turn_loss": 0.08268710970878601,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.42231927151087156,
      "grad_norm": 0.30308812856674194,
      "learning_rate": 1.4097365909560234e-06,
      "loss": 0.0696,
      "mae_dtheta": 0.008115665055811405,
      "mae_dx": 0.0015975316055119038,
      "mae_dy": 0.001640578848309815,
      "pose_mae_dtheta": 0.0550326406955719,
      "pose_mae_dx": 0.014862209558486938,
      "pose_mae_dy": 0.01759602315723896,
      "pose_rmse_dtheta": 0.16235406696796417,
      "pose_rmse_dx": 0.04102883115410805,
      "pose_rmse_dy": 0.043811116367578506,
      "pose_rmse_mean": 0.08239800482988358,
      "rmse_dtheta": 0.021084032952785492,
      "rmse_dx": 0.005386634264141321,
      "rmse_dy": 0.004892387427389622,
      "rmse_mean": 0.010454352013766766,
      "rotation_flip": 0.0063492064364254475,
      "sparse_tokens": 32121.0,
      "step": 9090,
      "turn_loss": 0.06692791730165482,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17804.0,
      "epoch": 0.42236573127671434,
      "grad_norm": 0.36023667454719543,
      "learning_rate": 1.4088164668558302e-06,
      "loss": 0.0897,
      "mae_dtheta": 0.027570364996790886,
      "mae_dx": 0.010870885103940964,
      "mae_dy": 0.003571293316781521,
      "pose_mae_dtheta": 0.2258083075284958,
      "pose_mae_dx": 0.0830368846654892,
      "pose_mae_dy": 0.04117419943213463,
      "pose_rmse_dtheta": 0.4131268858909607,
      "pose_rmse_dx": 0.19439400732517242,
      "pose_rmse_dy": 0.10162856429815292,
      "pose_rmse_mean": 0.23638314008712769,
      "rmse_dtheta": 0.04447127506136894,
      "rmse_dx": 0.02268063835799694,
      "rmse_dy": 0.0075138406828045845,
      "rmse_mean": 0.02488858625292778,
      "rotation_flip": 0.013853903859853745,
      "sparse_tokens": 13981.0,
      "step": 9091,
      "turn_loss": 0.228554368019104,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 11705.0,
      "epoch": 0.4224121910425572,
      "grad_norm": 0.4932612478733063,
      "learning_rate": 1.407896593889031e-06,
      "loss": 0.1087,
      "mae_dtheta": 0.03032936342060566,
      "mae_dx": 0.012352964840829372,
      "mae_dy": 0.00739086139947176,
      "pose_mae_dtheta": 0.23600617051124573,
      "pose_mae_dx": 0.09501242637634277,
      "pose_mae_dy": 0.07404472678899765,
      "pose_rmse_dtheta": 0.4480462372303009,
      "pose_rmse_dx": 0.20874102413654327,
      "pose_rmse_dy": 0.2334587275981903,
      "pose_rmse_mean": 0.29674869775772095,
      "rmse_dtheta": 0.05081634595990181,
      "rmse_dx": 0.025454726070165634,
      "rmse_dy": 0.016239266842603683,
      "rmse_mean": 0.03083678148686886,
      "rotation_flip": 0.014625228941440582,
      "sparse_tokens": 9931.0,
      "step": 9092,
      "turn_loss": 0.28304019570350647,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 33310.0,
      "epoch": 0.42245865080839995,
      "grad_norm": 0.547631561756134,
      "learning_rate": 1.406976972119949e-06,
      "loss": 0.1367,
      "mae_dtheta": 0.03965259715914726,
      "mae_dx": 0.010946337133646011,
      "mae_dy": 0.004001633729785681,
      "pose_mae_dtheta": 0.33435389399528503,
      "pose_mae_dx": 0.08656870573759079,
      "pose_mae_dy": 0.04656187817454338,
      "pose_rmse_dtheta": 0.5976893305778503,
      "pose_rmse_dx": 0.22080010175704956,
      "pose_rmse_dy": 0.1180785745382309,
      "pose_rmse_mean": 0.31218934059143066,
      "rmse_dtheta": 0.061760589480400085,
      "rmse_dx": 0.024222061038017273,
      "rmse_dy": 0.010600858367979527,
      "rmse_mean": 0.03219450265169144,
      "rotation_flip": 0.010526316240429878,
      "sparse_tokens": 26351.0,
      "step": 9093,
      "turn_loss": 0.24390219151973724,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4225051105742427,
      "grad_norm": 0.6266849040985107,
      "learning_rate": 1.4060576016128974e-06,
      "loss": 0.1331,
      "mae_dtheta": 0.0070768436416983604,
      "mae_dx": 0.0012610828271135688,
      "mae_dy": 0.0015846119495108724,
      "pose_mae_dtheta": 0.05189881473779678,
      "pose_mae_dx": 0.015628527849912643,
      "pose_mae_dy": 0.01984499767422676,
      "pose_rmse_dtheta": 0.14360663294792175,
      "pose_rmse_dx": 0.045596085488796234,
      "pose_rmse_dy": 0.054262492805719376,
      "pose_rmse_mean": 0.08115507662296295,
      "rmse_dtheta": 0.01849190518260002,
      "rmse_dx": 0.00422940356656909,
      "rmse_dy": 0.004321713000535965,
      "rmse_mean": 0.009014341048896313,
      "rotation_flip": 0.003634475637227297,
      "sparse_tokens": 32073.0,
      "step": 9094,
      "turn_loss": 0.05905475094914436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.4225515703400855,
      "grad_norm": 0.617446780204773,
      "learning_rate": 1.405138482432165e-06,
      "loss": 0.1133,
      "mae_dtheta": 0.02370084635913372,
      "mae_dx": 0.00499329948797822,
      "mae_dy": 0.003760696155950427,
      "pose_mae_dtheta": 0.16700445115566254,
      "pose_mae_dx": 0.04510924592614174,
      "pose_mae_dy": 0.0328683964908123,
      "pose_rmse_dtheta": 0.33056241273880005,
      "pose_rmse_dx": 0.10291755944490433,
      "pose_rmse_dy": 0.07903136312961578,
      "pose_rmse_mean": 0.17083710432052612,
      "rmse_dtheta": 0.04146362096071243,
      "rmse_dx": 0.012031001970171928,
      "rmse_dy": 0.00935300998389721,
      "rmse_mean": 0.020949212834239006,
      "rotation_flip": 0.010075566358864307,
      "sparse_tokens": 21200.0,
      "step": 9095,
      "turn_loss": 0.22654575109481812,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4225980301059283,
      "grad_norm": 0.5632228255271912,
      "learning_rate": 1.4042196146420284e-06,
      "loss": 0.1423,
      "mae_dtheta": 0.0105056744068861,
      "mae_dx": 0.001131890807300806,
      "mae_dy": 0.002075119176879525,
      "pose_mae_dtheta": 0.0628139078617096,
      "pose_mae_dx": 0.014470013789832592,
      "pose_mae_dy": 0.024832086637616158,
      "pose_rmse_dtheta": 0.16220127046108246,
      "pose_rmse_dx": 0.034674640744924545,
      "pose_rmse_dy": 0.059016693383455276,
      "pose_rmse_mean": 0.08529753983020782,
      "rmse_dtheta": 0.023503391072154045,
      "rmse_dx": 0.003948920406401157,
      "rmse_dy": 0.0050127701833844185,
      "rmse_mean": 0.010821694508194923,
      "rotation_flip": 0.003672420047223568,
      "sparse_tokens": 32105.0,
      "step": 9096,
      "turn_loss": 0.08134199678897858,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.42264448987177106,
      "grad_norm": 0.3886963725090027,
      "learning_rate": 1.4033009983067454e-06,
      "loss": 0.0907,
      "mae_dtheta": 0.010443505831062794,
      "mae_dx": 0.0020329745020717382,
      "mae_dy": 0.003401672001928091,
      "pose_mae_dtheta": 0.06886028498411179,
      "pose_mae_dx": 0.02359463833272457,
      "pose_mae_dy": 0.02935374155640602,
      "pose_rmse_dtheta": 0.14133736491203308,
      "pose_rmse_dx": 0.06404848396778107,
      "pose_rmse_dy": 0.07052052766084671,
      "pose_rmse_mean": 0.09196879714727402,
      "rmse_dtheta": 0.020922087132930756,
      "rmse_dx": 0.005517690442502499,
      "rmse_dy": 0.007933158427476883,
      "rmse_mean": 0.011457646265625954,
      "rotation_flip": 0.004021447617560625,
      "sparse_tokens": 32169.0,
      "step": 9097,
      "turn_loss": 0.10269948840141296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.42269094963761383,
      "grad_norm": 0.5361464023590088,
      "learning_rate": 1.4023826334905527e-06,
      "loss": 0.1498,
      "mae_dtheta": 0.007673983462154865,
      "mae_dx": 0.0010983286192640662,
      "mae_dy": 0.0015567580703645945,
      "pose_mae_dtheta": 0.0482930988073349,
      "pose_mae_dx": 0.015251923352479935,
      "pose_mae_dy": 0.019636720418930054,
      "pose_rmse_dtheta": 0.14742635190486908,
      "pose_rmse_dx": 0.03779122605919838,
      "pose_rmse_dy": 0.0430341511964798,
      "pose_rmse_mean": 0.07608391344547272,
      "rmse_dtheta": 0.017945393919944763,
      "rmse_dx": 0.0033678298350423574,
      "rmse_dy": 0.0032111385371536016,
      "rmse_mean": 0.00817478820681572,
      "rotation_flip": 0.0011307953391224146,
      "sparse_tokens": 32089.0,
      "step": 9098,
      "turn_loss": 0.060154590755701065,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4227374094034566,
      "grad_norm": 0.5289785265922546,
      "learning_rate": 1.401464520257675e-06,
      "loss": 0.0884,
      "mae_dtheta": 0.0083793168887496,
      "mae_dx": 0.002048894762992859,
      "mae_dy": 0.0014722462510690093,
      "pose_mae_dtheta": 0.0645751878619194,
      "pose_mae_dx": 0.02076726034283638,
      "pose_mae_dy": 0.01887660287320614,
      "pose_rmse_dtheta": 0.20206956565380096,
      "pose_rmse_dx": 0.063688263297081,
      "pose_rmse_dy": 0.06088440492749214,
      "pose_rmse_mean": 0.10888075083494186,
      "rmse_dtheta": 0.02246934361755848,
      "rmse_dx": 0.007217356935143471,
      "rmse_dy": 0.003835114883258939,
      "rmse_mean": 0.01117393933236599,
      "rotation_flip": 0.003599280258640647,
      "sparse_tokens": 32073.0,
      "step": 9099,
      "turn_loss": 0.06080335006117821,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.4227838691692994,
      "grad_norm": 0.6090542078018188,
      "learning_rate": 1.4005466586723127e-06,
      "loss": 0.1915,
      "mae_dtheta": 0.036927178502082825,
      "mae_dx": 0.012177342548966408,
      "mae_dy": 0.002931575756520033,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6090543270111084,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.62159729003906,
      "model/head/act_norm_mean": 97.84709231954226,
      "model/head/act_norm_min": 66.19232177734375,
      "model/head/act_over_embed": 67.24143790090048,
      "model/head/grad_frac": 0.12426764518022537,
      "model/head/grad_norm": 0.07568574696779251,
      "model/head/grad_zero_frac": 0.0001729131181491539,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6906360035211268,
      "model/head/update_ratio": 0.001288793864659965,
      "model/head/weight_delta": 9.871543884277344,
      "model/head/weight_delta_rel": 0.1731761246919632,
      "model/head/weight_norm": 58.72602844238281,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4226688742637634,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42261915736728245,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.422534704208374,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904278415656854,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08664661645889282,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05277249589562416,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5537923177083334,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001704065827652812,
      "model/modality_embedder.encoders.pose/weight_delta": 3.134647846221924,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10241871327161789,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968578338623047,
      "model/modality_embedder/grad_frac": 0.08664661645889282,
      "model/modality_embedder/grad_norm": 0.05277249589562416,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5537923177083334,
      "model/modality_embedder/update_ratio": 0.001704065827652812,
      "model/modality_embedder/weight_delta": 3.134647846221924,
      "model/modality_embedder/weight_delta_rel": 0.10241871327161789,
      "model/modality_embedder/weight_norm": 30.968578338623047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.34988403320312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.43907891795216,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.286685943603516,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.420345110383385,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09113314002752304,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05550503358244896,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019860079046338797,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6829893589019775,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09776975214481354,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.948043823242188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 75.5533447265625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.199554968701097,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.649357795715332,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.942951372147016,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.10047964751720428,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.061197564005851746,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002057103905826807,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4012691974639893,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11782262474298477,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.749378204345703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 76.76441192626953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.771346830985916,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.700592994689941,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.023101455256402,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09444726258516312,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.057523515075445175,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0018725376576185226,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.681777238845825,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1236271858215332,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.71955108642578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.95381164550781,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.612730200648336,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.700401306152344,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.288517346191135,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.1009569764137268,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.061488281935453415,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020538822282105684,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1603684425354004,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10800639539957047,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.93758773803711,
      "model/normalizer/grad_frac": 0.38196808099746704,
      "model/normalizer/grad_norm": 0.23263931274414062,
      "model/normalizer/grad_zero_frac": 0.00016426164074800909,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0029585100710392,
      "model/normalizer/weight_delta": 6.655980110168457,
      "model/normalizer/weight_delta_rel": 0.08572517335414886,
      "model/normalizer/weight_norm": 78.63394165039062,
      "pose_mae_dtheta": 0.29194679856300354,
      "pose_mae_dx": 0.0973900631070137,
      "pose_mae_dy": 0.030399737879633904,
      "pose_rmse_dtheta": 0.5276949405670166,
      "pose_rmse_dx": 0.2441394180059433,
      "pose_rmse_dy": 0.08303602039813995,
      "pose_rmse_mean": 0.28495681285858154,
      "rmse_dtheta": 0.05706144869327545,
      "rmse_dx": 0.02582033909857273,
      "rmse_dy": 0.006872702855616808,
      "rmse_mean": 0.029918164014816284,
      "rotation_flip": 0.015681544318795204,
      "sparse_tokens": 16903.0,
      "step": 9100,
      "turn_loss": 0.28972750902175903,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.42283032893514216,
      "grad_norm": 0.7322691082954407,
      "learning_rate": 1.3996290487986568e-06,
      "loss": 0.1329,
      "mae_dtheta": 0.03298042342066765,
      "mae_dx": 0.009482542052865028,
      "mae_dy": 0.003672969061881304,
      "pose_mae_dtheta": 0.2814512848854065,
      "pose_mae_dx": 0.07318048924207687,
      "pose_mae_dy": 0.04698236286640167,
      "pose_rmse_dtheta": 0.4830627739429474,
      "pose_rmse_dx": 0.1745022088289261,
      "pose_rmse_dy": 0.14899471402168274,
      "pose_rmse_mean": 0.26885324716567993,
      "rmse_dtheta": 0.04888327419757843,
      "rmse_dx": 0.020597979426383972,
      "rmse_dy": 0.008818626403808594,
      "rmse_mean": 0.02609996125102043,
      "rotation_flip": 0.013282732106745243,
      "sparse_tokens": 11124.0,
      "step": 9101,
      "turn_loss": 0.26382946968078613,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.42287678870098494,
      "grad_norm": 0.423578143119812,
      "learning_rate": 1.3987116907008718e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.009610858745872974,
      "mae_dx": 0.0015618179459124804,
      "mae_dy": 0.0018191441195085645,
      "pose_mae_dtheta": 0.06805136054754257,
      "pose_mae_dx": 0.017853163182735443,
      "pose_mae_dy": 0.022684963420033455,
      "pose_rmse_dtheta": 0.18733276426792145,
      "pose_rmse_dx": 0.05203435942530632,
      "pose_rmse_dy": 0.06911125779151917,
      "pose_rmse_mean": 0.10282613337039948,
      "rmse_dtheta": 0.023870665580034256,
      "rmse_dx": 0.005152100697159767,
      "rmse_dy": 0.004738246090710163,
      "rmse_mean": 0.01125367172062397,
      "rotation_flip": 0.0036591740790754557,
      "sparse_tokens": 32073.0,
      "step": 9102,
      "turn_loss": 0.06663526594638824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.4229232484668277,
      "grad_norm": 0.6728026866912842,
      "learning_rate": 1.3977945844431118e-06,
      "loss": 0.1972,
      "mae_dtheta": 0.030559701845049858,
      "mae_dx": 0.015491108410060406,
      "mae_dy": 0.00809176079928875,
      "pose_mae_dtheta": 0.236003577709198,
      "pose_mae_dx": 0.1239481270313263,
      "pose_mae_dy": 0.08791306614875793,
      "pose_rmse_dtheta": 0.4268674850463867,
      "pose_rmse_dx": 0.2547767758369446,
      "pose_rmse_dy": 0.17946690320968628,
      "pose_rmse_mean": 0.28703707456588745,
      "rmse_dtheta": 0.04722272604703903,
      "rmse_dx": 0.028347011655569077,
      "rmse_dy": 0.0147803770378232,
      "rmse_mean": 0.03011670522391796,
      "rotation_flip": 0.009433962404727936,
      "sparse_tokens": 21748.0,
      "step": 9103,
      "turn_loss": 0.37072181701660156,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4229697082326705,
      "grad_norm": 0.5577565431594849,
      "learning_rate": 1.3968777300895109e-06,
      "loss": 0.1237,
      "mae_dtheta": 0.008931226097047329,
      "mae_dx": 0.0014923436101526022,
      "mae_dy": 0.0022894751746207476,
      "pose_mae_dtheta": 0.05346517637372017,
      "pose_mae_dx": 0.019514691084623337,
      "pose_mae_dy": 0.022425124421715736,
      "pose_rmse_dtheta": 0.13377058506011963,
      "pose_rmse_dx": 0.05118614062666893,
      "pose_rmse_dy": 0.049537405371665955,
      "pose_rmse_mean": 0.0781647115945816,
      "rmse_dtheta": 0.018563028424978256,
      "rmse_dx": 0.004185703117400408,
      "rmse_dy": 0.004952865652740002,
      "rmse_mean": 0.009233865886926651,
      "rotation_flip": 0.0011398176429793239,
      "sparse_tokens": 32121.0,
      "step": 9104,
      "turn_loss": 0.0820239707827568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.42301616799851327,
      "grad_norm": 0.545022189617157,
      "learning_rate": 1.3959611277041834e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.01922783814370632,
      "mae_dx": 0.005051070358604193,
      "mae_dy": 0.0026364289224147797,
      "pose_mae_dtheta": 0.1445387750864029,
      "pose_mae_dx": 0.04361160099506378,
      "pose_mae_dy": 0.036741893738508224,
      "pose_rmse_dtheta": 0.30574557185173035,
      "pose_rmse_dx": 0.14479626715183258,
      "pose_rmse_dy": 0.10017474740743637,
      "pose_rmse_mean": 0.1835722029209137,
      "rmse_dtheta": 0.036905623972415924,
      "rmse_dx": 0.01531093567609787,
      "rmse_dy": 0.007056834176182747,
      "rmse_mean": 0.019757797941565514,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 20388.0,
      "step": 9105,
      "turn_loss": 0.12908606231212616,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 35902.0,
      "epoch": 0.42306262776435605,
      "grad_norm": 0.628369927406311,
      "learning_rate": 1.39504477735123e-06,
      "loss": 0.119,
      "mae_dtheta": 0.03532131388783455,
      "mae_dx": 0.014346945099532604,
      "mae_dy": 0.004506584256887436,
      "pose_mae_dtheta": 0.26925843954086304,
      "pose_mae_dx": 0.12096227705478668,
      "pose_mae_dy": 0.05504174530506134,
      "pose_rmse_dtheta": 0.4962320327758789,
      "pose_rmse_dx": 0.2568928897380829,
      "pose_rmse_dy": 0.13281740248203278,
      "pose_rmse_mean": 0.29531413316726685,
      "rmse_dtheta": 0.053591981530189514,
      "rmse_dx": 0.027476483955979347,
      "rmse_dy": 0.00869124848395586,
      "rmse_mean": 0.029919905588030815,
      "rotation_flip": 0.01295641902834177,
      "sparse_tokens": 26149.0,
      "step": 9106,
      "turn_loss": 0.2842474579811096,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 28874.0,
      "epoch": 0.4231090875301988,
      "grad_norm": 0.9032495617866516,
      "learning_rate": 1.3941286790947284e-06,
      "loss": 0.2644,
      "mae_dtheta": 0.031093401834368706,
      "mae_dx": 0.010584509931504726,
      "mae_dy": 0.003870371961966157,
      "pose_mae_dtheta": 0.2357015609741211,
      "pose_mae_dx": 0.08259386569261551,
      "pose_mae_dy": 0.05699393153190613,
      "pose_rmse_dtheta": 0.419232577085495,
      "pose_rmse_dx": 0.18834172189235687,
      "pose_rmse_dy": 0.1327950656414032,
      "pose_rmse_mean": 0.24678978323936462,
      "rmse_dtheta": 0.04900921508669853,
      "rmse_dx": 0.022557592019438744,
      "rmse_dy": 0.007798185106366873,
      "rmse_mean": 0.026454998180270195,
      "rotation_flip": 0.013648771680891514,
      "sparse_tokens": 22659.0,
      "step": 9107,
      "turn_loss": 0.2648693025112152,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.4231555472960416,
      "grad_norm": 0.5793355107307434,
      "learning_rate": 1.3932128329987431e-06,
      "loss": 0.0933,
      "mae_dtheta": 0.03174690157175064,
      "mae_dx": 0.01208722498267889,
      "mae_dy": 0.005285368300974369,
      "pose_mae_dtheta": 0.2195482701063156,
      "pose_mae_dx": 0.10384288430213928,
      "pose_mae_dy": 0.07101670652627945,
      "pose_rmse_dtheta": 0.3514770567417145,
      "pose_rmse_dx": 0.2366434931755066,
      "pose_rmse_dy": 0.15747274458408356,
      "pose_rmse_mean": 0.24853110313415527,
      "rmse_dtheta": 0.04720133915543556,
      "rmse_dx": 0.02481563203036785,
      "rmse_dy": 0.009366238489747047,
      "rmse_mean": 0.027127735316753387,
      "rotation_flip": 0.016736401244997978,
      "sparse_tokens": 7254.0,
      "step": 9108,
      "turn_loss": 0.3037506937980652,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.42320200706188443,
      "grad_norm": 0.5294362902641296,
      "learning_rate": 1.3922972391273226e-06,
      "loss": 0.1097,
      "mae_dtheta": 0.012935646809637547,
      "mae_dx": 0.0022095455788075924,
      "mae_dy": 0.003530363319441676,
      "pose_mae_dtheta": 0.08344467729330063,
      "pose_mae_dx": 0.03046501986682415,
      "pose_mae_dy": 0.032862234860658646,
      "pose_rmse_dtheta": 0.2040454000234604,
      "pose_rmse_dx": 0.07576524466276169,
      "pose_rmse_dy": 0.08436783403158188,
      "pose_rmse_mean": 0.12139283120632172,
      "rmse_dtheta": 0.026355570182204247,
      "rmse_dx": 0.005619153846055269,
      "rmse_dy": 0.008155446499586105,
      "rmse_mean": 0.013376723974943161,
      "rotation_flip": 0.0023163468576967716,
      "sparse_tokens": 32105.0,
      "step": 9109,
      "turn_loss": 0.1214529499411583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.4232484668277272,
      "grad_norm": 0.5032820701599121,
      "learning_rate": 1.391381897544491e-06,
      "loss": 0.1392,
      "mae_dtheta": 0.027970125898718834,
      "mae_dx": 0.008045305497944355,
      "mae_dy": 0.006039012689143419,
      "pose_mae_dtheta": 0.19039800763130188,
      "pose_mae_dx": 0.07073596864938736,
      "pose_mae_dy": 0.08118527382612228,
      "pose_rmse_dtheta": 0.4132355749607086,
      "pose_rmse_dx": 0.13947179913520813,
      "pose_rmse_dy": 0.16569998860359192,
      "pose_rmse_mean": 0.23946914076805115,
      "rmse_dtheta": 0.04607364535331726,
      "rmse_dx": 0.017299287021160126,
      "rmse_dy": 0.01075704488903284,
      "rmse_mean": 0.024709992110729218,
      "rotation_flip": 0.023474179208278656,
      "sparse_tokens": 4575.0,
      "step": 9110,
      "turn_loss": 0.2409774512052536,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.42329492659357,
      "grad_norm": 0.44133260846138,
      "learning_rate": 1.3904668083142615e-06,
      "loss": 0.1095,
      "mae_dtheta": 0.03928030654788017,
      "mae_dx": 0.017343765124678612,
      "mae_dy": 0.01076977327466011,
      "pose_mae_dtheta": 0.30744433403015137,
      "pose_mae_dx": 0.15032553672790527,
      "pose_mae_dy": 0.12166190892457962,
      "pose_rmse_dtheta": 0.5079026818275452,
      "pose_rmse_dx": 0.2809985280036926,
      "pose_rmse_dy": 0.24972334504127502,
      "pose_rmse_mean": 0.3462081849575043,
      "rmse_dtheta": 0.0571267269551754,
      "rmse_dx": 0.03128010779619217,
      "rmse_dy": 0.019309381023049355,
      "rmse_mean": 0.03590540587902069,
      "rotation_flip": 0.019138755276799202,
      "sparse_tokens": 11092.0,
      "step": 9111,
      "turn_loss": 0.37990549206733704,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 13001.0,
      "epoch": 0.42334138635941276,
      "grad_norm": 1.0820144414901733,
      "learning_rate": 1.389551971500624e-06,
      "loss": 0.2347,
      "mae_dtheta": 0.024594468995928764,
      "mae_dx": 0.00903008971363306,
      "mae_dy": 0.0034988103434443474,
      "pose_mae_dtheta": 0.15957307815551758,
      "pose_mae_dx": 0.05668731406331062,
      "pose_mae_dy": 0.03969012573361397,
      "pose_rmse_dtheta": 0.33477121591567993,
      "pose_rmse_dx": 0.15256032347679138,
      "pose_rmse_dy": 0.09618513286113739,
      "pose_rmse_mean": 0.19450555741786957,
      "rmse_dtheta": 0.04284793511033058,
      "rmse_dx": 0.020844655111432076,
      "rmse_dy": 0.007935852743685246,
      "rmse_mean": 0.023876149207353592,
      "rotation_flip": 0.018656715750694275,
      "sparse_tokens": 10110.0,
      "step": 9112,
      "turn_loss": 0.17461399734020233,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 31466.0,
      "epoch": 0.42338784612525554,
      "grad_norm": 0.5511149168014526,
      "learning_rate": 1.3886373871675568e-06,
      "loss": 0.1453,
      "mae_dtheta": 0.030243773013353348,
      "mae_dx": 0.011264476925134659,
      "mae_dy": 0.0030060450080782175,
      "pose_mae_dtheta": 0.23923933506011963,
      "pose_mae_dx": 0.08347976952791214,
      "pose_mae_dy": 0.03685710206627846,
      "pose_rmse_dtheta": 0.44060489535331726,
      "pose_rmse_dx": 0.20482707023620605,
      "pose_rmse_dy": 0.09672929346561432,
      "pose_rmse_mean": 0.24738709628582,
      "rmse_dtheta": 0.04807361215353012,
      "rmse_dx": 0.023959733545780182,
      "rmse_dy": 0.006683208514004946,
      "rmse_mean": 0.026238851249217987,
      "rotation_flip": 0.010702340863645077,
      "sparse_tokens": 24410.0,
      "step": 9113,
      "turn_loss": 0.24447332322597504,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.4234343058910983,
      "grad_norm": 0.3785025477409363,
      "learning_rate": 1.3877230553790133e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.03678632527589798,
      "mae_dx": 0.013974003493785858,
      "mae_dy": 0.0038796081207692623,
      "pose_mae_dtheta": 0.27708449959754944,
      "pose_mae_dx": 0.09920621663331985,
      "pose_mae_dy": 0.04364582896232605,
      "pose_rmse_dtheta": 0.4511953592300415,
      "pose_rmse_dx": 0.21970908343791962,
      "pose_rmse_dy": 0.10310620069503784,
      "pose_rmse_mean": 0.2580035626888275,
      "rmse_dtheta": 0.05321965366601944,
      "rmse_dx": 0.026130435988307,
      "rmse_dy": 0.008105572313070297,
      "rmse_mean": 0.029151886701583862,
      "rotation_flip": 0.015018773265182972,
      "sparse_tokens": 10898.0,
      "step": 9114,
      "turn_loss": 0.31339117884635925,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4234807656569411,
      "grad_norm": 0.48497292399406433,
      "learning_rate": 1.3868089761989356e-06,
      "loss": 0.0817,
      "mae_dtheta": 0.005184724926948547,
      "mae_dx": 0.0013602349208667874,
      "mae_dy": 0.000658916775137186,
      "pose_mae_dtheta": 0.03890005126595497,
      "pose_mae_dx": 0.0128014562651515,
      "pose_mae_dy": 0.012527368031442165,
      "pose_rmse_dtheta": 0.12979573011398315,
      "pose_rmse_dx": 0.041158538311719894,
      "pose_rmse_dy": 0.035276953130960464,
      "pose_rmse_mean": 0.0687437430024147,
      "rmse_dtheta": 0.016455447301268578,
      "rmse_dx": 0.0051447185687720776,
      "rmse_dy": 0.001715190359391272,
      "rmse_mean": 0.007771785836666822,
      "rotation_flip": 0.0031796502880752087,
      "sparse_tokens": 32073.0,
      "step": 9115,
      "turn_loss": 0.03845357522368431,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.42352722542278387,
      "grad_norm": 0.37548550963401794,
      "learning_rate": 1.385895149691247e-06,
      "loss": 0.0837,
      "mae_dtheta": 0.009597505442798138,
      "mae_dx": 0.0010624728165566921,
      "mae_dy": 0.0017773205181583762,
      "pose_mae_dtheta": 0.06596998870372772,
      "pose_mae_dx": 0.016451925039291382,
      "pose_mae_dy": 0.025830795988440514,
      "pose_rmse_dtheta": 0.17390947043895721,
      "pose_rmse_dx": 0.04243652895092964,
      "pose_rmse_dy": 0.06492789089679718,
      "pose_rmse_mean": 0.09375797212123871,
      "rmse_dtheta": 0.022352255880832672,
      "rmse_dx": 0.0029127097222954035,
      "rmse_dy": 0.004124521277844906,
      "rmse_mean": 0.00979649554938078,
      "rotation_flip": 0.0030755712650716305,
      "sparse_tokens": 32105.0,
      "step": 9116,
      "turn_loss": 0.07943099737167358,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.42357368518862665,
      "grad_norm": 0.4422864615917206,
      "learning_rate": 1.3849815759198492e-06,
      "loss": 0.1048,
      "mae_dtheta": 0.008824781514704227,
      "mae_dx": 0.001726834219880402,
      "mae_dy": 0.0015831048367545009,
      "pose_mae_dtheta": 0.06331972777843475,
      "pose_mae_dx": 0.018430061638355255,
      "pose_mae_dy": 0.013437743298709393,
      "pose_rmse_dtheta": 0.23442420363426208,
      "pose_rmse_dx": 0.06582186371088028,
      "pose_rmse_dy": 0.04069628566503525,
      "pose_rmse_mean": 0.1136474534869194,
      "rmse_dtheta": 0.027493080124258995,
      "rmse_dx": 0.005239286459982395,
      "rmse_dy": 0.005442841909825802,
      "rmse_mean": 0.012725070118904114,
      "rotation_flip": 0.0037932670675218105,
      "sparse_tokens": 32169.0,
      "step": 9117,
      "turn_loss": 0.06004614382982254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4236201449544694,
      "grad_norm": 0.5159851908683777,
      "learning_rate": 1.3840682549486316e-06,
      "loss": 0.1425,
      "mae_dtheta": 0.011961099691689014,
      "mae_dx": 0.0020501096732914448,
      "mae_dy": 0.0028854794800281525,
      "pose_mae_dtheta": 0.08686092495918274,
      "pose_mae_dx": 0.025051118806004524,
      "pose_mae_dy": 0.029943102970719337,
      "pose_rmse_dtheta": 0.2188667207956314,
      "pose_rmse_dx": 0.08562587201595306,
      "pose_rmse_dy": 0.06477247178554535,
      "pose_rmse_mean": 0.12308835983276367,
      "rmse_dtheta": 0.025808222591876984,
      "rmse_dx": 0.006748073268681765,
      "rmse_dy": 0.00773873645812273,
      "rmse_mean": 0.013431677594780922,
      "rotation_flip": 0.004063538741320372,
      "sparse_tokens": 32105.0,
      "step": 9118,
      "turn_loss": 0.11090710014104843,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4236666047203122,
      "grad_norm": 0.5864056348800659,
      "learning_rate": 1.38315518684146e-06,
      "loss": 0.1165,
      "mae_dtheta": 0.011431719176471233,
      "mae_dx": 0.002975201467052102,
      "mae_dy": 0.0038543744012713432,
      "pose_mae_dtheta": 0.08318857103586197,
      "pose_mae_dx": 0.030413325875997543,
      "pose_mae_dy": 0.040047429502010345,
      "pose_rmse_dtheta": 0.19277070462703705,
      "pose_rmse_dx": 0.0852731466293335,
      "pose_rmse_dy": 0.0959852859377861,
      "pose_rmse_mean": 0.12467639148235321,
      "rmse_dtheta": 0.023683996871113777,
      "rmse_dx": 0.008317127823829651,
      "rmse_dy": 0.008059930056333542,
      "rmse_mean": 0.013353684917092323,
      "rotation_flip": 0.005181347019970417,
      "sparse_tokens": 32089.0,
      "step": 9119,
      "turn_loss": 0.11603746563196182,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.423713064486155,
      "grad_norm": 0.36569535732269287,
      "learning_rate": 1.3822423716621891e-06,
      "loss": 0.09,
      "mae_dtheta": 0.0074181994423270226,
      "mae_dx": 0.0012310943566262722,
      "mae_dy": 0.0016518241027370095,
      "pose_mae_dtheta": 0.04933610558509827,
      "pose_mae_dx": 0.017660098150372505,
      "pose_mae_dy": 0.0214366652071476,
      "pose_rmse_dtheta": 0.10773217678070068,
      "pose_rmse_dx": 0.056646332144737244,
      "pose_rmse_dy": 0.05478911101818085,
      "pose_rmse_mean": 0.07305587828159332,
      "rmse_dtheta": 0.015802685171365738,
      "rmse_dx": 0.003476387821137905,
      "rmse_dy": 0.004269860219210386,
      "rmse_mean": 0.007849644869565964,
      "rotation_flip": 0.003399708541110158,
      "sparse_tokens": 32105.0,
      "step": 9120,
      "turn_loss": 0.06799368560314178,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15593.0,
      "epoch": 0.42375952425199775,
      "grad_norm": 0.632785439491272,
      "learning_rate": 1.3813298094746491e-06,
      "loss": 0.0945,
      "mae_dtheta": 0.02825598232448101,
      "mae_dx": 0.008237013593316078,
      "mae_dy": 0.0035842701327055693,
      "pose_mae_dtheta": 0.2103060483932495,
      "pose_mae_dx": 0.06612374633550644,
      "pose_mae_dy": 0.051632702350616455,
      "pose_rmse_dtheta": 0.3870162069797516,
      "pose_rmse_dx": 0.15340662002563477,
      "pose_rmse_dy": 0.1415664255619049,
      "pose_rmse_mean": 0.22732973098754883,
      "rmse_dtheta": 0.04723048210144043,
      "rmse_dx": 0.018946748226881027,
      "rmse_dy": 0.008127435110509396,
      "rmse_mean": 0.024768223986029625,
      "rotation_flip": 0.007215007208287716,
      "sparse_tokens": 12655.0,
      "step": 9121,
      "turn_loss": 0.232516810297966,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.42380598401784053,
      "grad_norm": 0.46379780769348145,
      "learning_rate": 1.380417500342658e-06,
      "loss": 0.1071,
      "mae_dtheta": 0.04184439033269882,
      "mae_dx": 0.012266804464161396,
      "mae_dy": 0.003727853298187256,
      "pose_mae_dtheta": 0.35351845622062683,
      "pose_mae_dx": 0.10563960671424866,
      "pose_mae_dy": 0.05433433875441551,
      "pose_rmse_dtheta": 0.5786552429199219,
      "pose_rmse_dx": 0.21698160469532013,
      "pose_rmse_dy": 0.1298755705356598,
      "pose_rmse_mean": 0.3085041642189026,
      "rmse_dtheta": 0.060556139796972275,
      "rmse_dx": 0.024071916937828064,
      "rmse_dy": 0.007919690571725368,
      "rmse_mean": 0.03084925189614296,
      "rotation_flip": 0.010380622930824757,
      "sparse_tokens": 9215.0,
      "step": 9122,
      "turn_loss": 0.30280011892318726,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4238524437836833,
      "grad_norm": 0.5029392838478088,
      "learning_rate": 1.3795054443300154e-06,
      "loss": 0.1492,
      "mae_dtheta": 0.009702859446406364,
      "mae_dx": 0.00175061437766999,
      "mae_dy": 0.0011807340197265148,
      "pose_mae_dtheta": 0.07471311837434769,
      "pose_mae_dx": 0.012644365429878235,
      "pose_mae_dy": 0.01379376370459795,
      "pose_rmse_dtheta": 0.2575603723526001,
      "pose_rmse_dx": 0.03369607403874397,
      "pose_rmse_dy": 0.03893251717090607,
      "pose_rmse_mean": 0.11006300151348114,
      "rmse_dtheta": 0.029264170676469803,
      "rmse_dx": 0.006047159433364868,
      "rmse_dy": 0.005487935151904821,
      "rmse_mean": 0.013599755242466927,
      "rotation_flip": 0.0029429076239466667,
      "sparse_tokens": 32121.0,
      "step": 9123,
      "turn_loss": 0.06256335973739624,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.4238989035495261,
      "grad_norm": 0.34291872382164,
      "learning_rate": 1.3785936415004986e-06,
      "loss": 0.0717,
      "mae_dtheta": 0.04284900799393654,
      "mae_dx": 0.02094695344567299,
      "mae_dy": 0.005764497444033623,
      "pose_mae_dtheta": 0.3412899374961853,
      "pose_mae_dx": 0.14832493662834167,
      "pose_mae_dy": 0.08806182444095612,
      "pose_rmse_dtheta": 0.5662078261375427,
      "pose_rmse_dx": 0.3111407458782196,
      "pose_rmse_dy": 0.21798431873321533,
      "pose_rmse_mean": 0.36511096358299255,
      "rmse_dtheta": 0.06320291012525558,
      "rmse_dx": 0.03565961867570877,
      "rmse_dy": 0.011415992863476276,
      "rmse_mean": 0.03675951063632965,
      "rotation_flip": 0.0071428571827709675,
      "sparse_tokens": 4580.0,
      "step": 9124,
      "turn_loss": 0.3000487983226776,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 1340.0,
      "epoch": 0.4239453633153689,
      "grad_norm": 0.8054132461547852,
      "learning_rate": 1.377682091917874e-06,
      "loss": 0.1321,
      "mae_dtheta": 0.031657882034778595,
      "mae_dx": 0.01497400552034378,
      "mae_dy": 0.005592052824795246,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8054133057594299,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 114.89900207519531,
      "model/head/act_norm_mean": 107.58760070800781,
      "model/head/act_norm_min": 103.7187728881836,
      "model/head/act_over_embed": 73.9352064575303,
      "model/head/grad_frac": 0.10020656883716583,
      "model/head/grad_norm": 0.08070770651102066,
      "model/head/grad_zero_frac": 7.86833988968283e-05,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.70166015625,
      "model/head/update_ratio": 0.0013742975424975157,
      "model/head/weight_delta": 9.87447738647461,
      "model/head/weight_delta_rel": 0.17322757840156555,
      "model/head/weight_norm": 58.72651672363281,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4226292371749878,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42261524200439454,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4225957989692688,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904251508916526,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1186731606721878,
      "model/modality_embedder.encoders.pose/grad_norm": 0.09558094292879105,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5484375,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0030863776337355375,
      "model/modality_embedder.encoders.pose/weight_delta": 3.134269952774048,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10240636765956879,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968647003173828,
      "model/modality_embedder/grad_frac": 0.1186731606721878,
      "model/modality_embedder/grad_norm": 0.09558094292879105,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5484375,
      "model/modality_embedder/update_ratio": 0.0030863776337355375,
      "model/modality_embedder/weight_delta": 3.134269952774048,
      "model/modality_embedder/weight_delta_rel": 0.10240636765956879,
      "model/modality_embedder/weight_norm": 30.968647003173828,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 59.077884674072266,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.277237180679563,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.255845069885254,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.996335315490946,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.1057637557387352,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0851835384964943,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0030478965491056442,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6844348907470703,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09782242774963379,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.94830322265625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 60.38640594482422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.014875139508927,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 13.112261772155762,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.503247026673858,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0960007905960083,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07732031494379044,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0025990172289311886,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4030561447143555,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11788452416658401,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.749828338623047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 61.91614532470703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.550994388640873,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.987771034240723,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.558882556052325,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08022573590278625,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06461487710475922,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0021033661905676126,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6836514472961426,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12369012087583542,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.719745635986328,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 62.49070358276367,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.54729740203373,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 14.547122955322266,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.93076067653917,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06924523413181305,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.055771034210920334,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001862903474830091,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.162278652191162,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10807167738676071,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.937694549560547,
      "model/normalizer/grad_frac": 0.3112737834453583,
      "model/normalizer/grad_norm": 0.2507040500640869,
      "model/normalizer/grad_zero_frac": 0.000109901673567947,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0031882249750196934,
      "model/normalizer/weight_delta": 6.659639358520508,
      "model/normalizer/weight_delta_rel": 0.08577229827642441,
      "model/normalizer/weight_norm": 78.63436889648438,
      "pose_mae_dtheta": 0.3026042878627777,
      "pose_mae_dx": 0.12936823070049286,
      "pose_mae_dy": 0.06204226240515709,
      "pose_rmse_dtheta": 0.4228074848651886,
      "pose_rmse_dx": 0.26468369364738464,
      "pose_rmse_dy": 0.12176328152418137,
      "pose_rmse_mean": 0.26975148916244507,
      "rmse_dtheta": 0.040474578738212585,
      "rmse_dx": 0.0288495272397995,
      "rmse_dy": 0.009020368568599224,
      "rmse_mean": 0.026114825159311295,
      "rotation_flip": 0.0,
      "sparse_tokens": 1046.0,
      "step": 9125,
      "turn_loss": 0.1959049105644226,
      "turns": 4.0,
      "turns_per_sample": 4.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4239918230812117,
      "grad_norm": 0.4831763505935669,
      "learning_rate": 1.3767707956458848e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.007889383472502232,
      "mae_dx": 0.0016841654432937503,
      "mae_dy": 0.002100718906149268,
      "pose_mae_dtheta": 0.051110755652189255,
      "pose_mae_dx": 0.020801542326807976,
      "pose_mae_dy": 0.022256504744291306,
      "pose_rmse_dtheta": 0.11750402301549911,
      "pose_rmse_dx": 0.05576349422335625,
      "pose_rmse_dy": 0.06194520741701126,
      "pose_rmse_mean": 0.07840424031019211,
      "rmse_dtheta": 0.017293456941843033,
      "rmse_dx": 0.004602774046361446,
      "rmse_dy": 0.005106905475258827,
      "rmse_mean": 0.009001046419143677,
      "rotation_flip": 0.002711864421144128,
      "sparse_tokens": 32201.0,
      "step": 9126,
      "turn_loss": 0.06900244206190109,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.42403828284705447,
      "grad_norm": 0.5670332312583923,
      "learning_rate": 1.375859752748257e-06,
      "loss": 0.1674,
      "mae_dtheta": 0.03448224067687988,
      "mae_dx": 0.006211153697222471,
      "mae_dy": 0.003816359443590045,
      "pose_mae_dtheta": 0.2763245701789856,
      "pose_mae_dx": 0.045942649245262146,
      "pose_mae_dy": 0.04103841632604599,
      "pose_rmse_dtheta": 0.5393446683883667,
      "pose_rmse_dx": 0.12512251734733582,
      "pose_rmse_dy": 0.09260653704404831,
      "pose_rmse_mean": 0.25235792994499207,
      "rmse_dtheta": 0.055752843618392944,
      "rmse_dx": 0.015433073975145817,
      "rmse_dy": 0.007193337194621563,
      "rmse_mean": 0.026126418262720108,
      "rotation_flip": 0.011869436129927635,
      "sparse_tokens": 12088.0,
      "step": 9127,
      "turn_loss": 0.2000320851802826,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.42408474261289725,
      "grad_norm": 0.5011699795722961,
      "learning_rate": 1.3749489632887036e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.01110279280692339,
      "mae_dx": 0.002810909878462553,
      "mae_dy": 0.004578242544084787,
      "pose_mae_dtheta": 0.07179956883192062,
      "pose_mae_dx": 0.04031652584671974,
      "pose_mae_dy": 0.03699963167309761,
      "pose_rmse_dtheta": 0.14450770616531372,
      "pose_rmse_dx": 0.11029776930809021,
      "pose_rmse_dy": 0.08732236921787262,
      "pose_rmse_mean": 0.11404262483119965,
      "rmse_dtheta": 0.02173508144915104,
      "rmse_dx": 0.0075041488744318485,
      "rmse_dy": 0.009788458235561848,
      "rmse_mean": 0.013009229674935341,
      "rotation_flip": 0.010409889742732048,
      "sparse_tokens": 32121.0,
      "step": 9128,
      "turn_loss": 0.12384889274835587,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.42413120237874,
      "grad_norm": 0.38720646500587463,
      "learning_rate": 1.3740384273309132e-06,
      "loss": 0.1047,
      "mae_dtheta": 0.009833699092268944,
      "mae_dx": 0.0024149962700903416,
      "mae_dy": 0.0038199385162442923,
      "pose_mae_dtheta": 0.06851072609424591,
      "pose_mae_dx": 0.02881484106183052,
      "pose_mae_dy": 0.03185946121811867,
      "pose_rmse_dtheta": 0.1497059464454651,
      "pose_rmse_dx": 0.09344275295734406,
      "pose_rmse_dy": 0.07563307881355286,
      "pose_rmse_mean": 0.10626059770584106,
      "rmse_dtheta": 0.020701907575130463,
      "rmse_dx": 0.007895413786172867,
      "rmse_dy": 0.009398888796567917,
      "rmse_mean": 0.012665404006838799,
      "rotation_flip": 0.0050231837667524815,
      "sparse_tokens": 32073.0,
      "step": 9129,
      "turn_loss": 0.10534920543432236,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.4241776621445828,
      "grad_norm": 0.3886672258377075,
      "learning_rate": 1.373128144938563e-06,
      "loss": 0.1014,
      "mae_dtheta": 0.02462022937834263,
      "mae_dx": 0.0059558008797466755,
      "mae_dy": 0.003688221797347069,
      "pose_mae_dtheta": 0.1692039668560028,
      "pose_mae_dx": 0.0522005669772625,
      "pose_mae_dy": 0.03412703052163124,
      "pose_rmse_dtheta": 0.2827646732330322,
      "pose_rmse_dx": 0.09473123401403427,
      "pose_rmse_dy": 0.06982313841581345,
      "pose_rmse_mean": 0.14910635352134705,
      "rmse_dtheta": 0.038243990391492844,
      "rmse_dx": 0.01395728625357151,
      "rmse_dy": 0.007105885539203882,
      "rmse_mean": 0.019769055768847466,
      "rotation_flip": 0.004357298370450735,
      "sparse_tokens": 7437.0,
      "step": 9130,
      "turn_loss": 0.20448504388332367,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 35255.0,
      "epoch": 0.4242241219104256,
      "grad_norm": 0.48507165908813477,
      "learning_rate": 1.3722181161753073e-06,
      "loss": 0.1657,
      "mae_dtheta": 0.02903580851852894,
      "mae_dx": 0.01328921690583229,
      "mae_dy": 0.004724595695734024,
      "pose_mae_dtheta": 0.24950458109378815,
      "pose_mae_dx": 0.11753341555595398,
      "pose_mae_dy": 0.06608802825212479,
      "pose_rmse_dtheta": 0.43657541275024414,
      "pose_rmse_dx": 0.278929203748703,
      "pose_rmse_dy": 0.1799788475036621,
      "pose_rmse_mean": 0.29849451780319214,
      "rmse_dtheta": 0.044639065861701965,
      "rmse_dx": 0.027129966765642166,
      "rmse_dy": 0.011658014729619026,
      "rmse_mean": 0.027809014543890953,
      "rotation_flip": 0.004594180732965469,
      "sparse_tokens": 25660.0,
      "step": 9131,
      "turn_loss": 0.2283460646867752,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.42427058167626835,
      "grad_norm": 0.39561161398887634,
      "learning_rate": 1.3713083411047873e-06,
      "loss": 0.0712,
      "mae_dtheta": 0.008818235248327255,
      "mae_dx": 0.0008202057215385139,
      "mae_dy": 0.0012622374342754483,
      "pose_mae_dtheta": 0.058078642934560776,
      "pose_mae_dx": 0.009579860605299473,
      "pose_mae_dy": 0.018122874200344086,
      "pose_rmse_dtheta": 0.18753498792648315,
      "pose_rmse_dx": 0.027111267670989037,
      "pose_rmse_dy": 0.042731668800115585,
      "pose_rmse_mean": 0.0857926458120346,
      "rmse_dtheta": 0.022497866302728653,
      "rmse_dx": 0.003465366316959262,
      "rmse_dy": 0.0028278983663767576,
      "rmse_mean": 0.009597043506801128,
      "rotation_flip": 0.008450704626739025,
      "sparse_tokens": 32073.0,
      "step": 9132,
      "turn_loss": 0.06848132610321045,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.42431704144211113,
      "grad_norm": 0.4973219633102417,
      "learning_rate": 1.3703988197906209e-06,
      "loss": 0.1227,
      "mae_dtheta": 0.008957936428487301,
      "mae_dx": 0.0011176011757925153,
      "mae_dy": 0.0019006901420652866,
      "pose_mae_dtheta": 0.05814053863286972,
      "pose_mae_dx": 0.016459768638014793,
      "pose_mae_dy": 0.02449381723999977,
      "pose_rmse_dtheta": 0.16234655678272247,
      "pose_rmse_dx": 0.04746439307928085,
      "pose_rmse_dy": 0.06207992881536484,
      "pose_rmse_mean": 0.09063029289245605,
      "rmse_dtheta": 0.020435623824596405,
      "rmse_dx": 0.0034955544397234917,
      "rmse_dy": 0.004386660177260637,
      "rmse_mean": 0.00943928025662899,
      "rotation_flip": 0.008120178245007992,
      "sparse_tokens": 32089.0,
      "step": 9133,
      "turn_loss": 0.06252653151750565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.4243635012079539,
      "grad_norm": 0.5339694023132324,
      "learning_rate": 1.369489552296413e-06,
      "loss": 0.1647,
      "mae_dtheta": 0.04409239813685417,
      "mae_dx": 0.019278766587376595,
      "mae_dy": 0.009954964742064476,
      "pose_mae_dtheta": 0.35599634051322937,
      "pose_mae_dx": 0.15040358901023865,
      "pose_mae_dy": 0.1360163539648056,
      "pose_rmse_dtheta": 0.6083138585090637,
      "pose_rmse_dx": 0.27915045619010925,
      "pose_rmse_dy": 0.26092854142189026,
      "pose_rmse_mean": 0.38279759883880615,
      "rmse_dtheta": 0.06346829235553741,
      "rmse_dx": 0.032119520008563995,
      "rmse_dy": 0.017252111807465553,
      "rmse_mean": 0.03761330991983414,
      "rotation_flip": 0.019490255042910576,
      "sparse_tokens": 11004.0,
      "step": 9134,
      "turn_loss": 0.34019964933395386,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4244099609737967,
      "grad_norm": 0.3568558990955353,
      "learning_rate": 1.3685805386857516e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.008744020015001297,
      "mae_dx": 0.001348815392702818,
      "mae_dy": 0.00167607213370502,
      "pose_mae_dtheta": 0.05796751752495766,
      "pose_mae_dx": 0.01690792106091976,
      "pose_mae_dy": 0.02336033619940281,
      "pose_rmse_dtheta": 0.12658776342868805,
      "pose_rmse_dx": 0.047585438936948776,
      "pose_rmse_dy": 0.05499473586678505,
      "pose_rmse_mean": 0.07638931274414062,
      "rmse_dtheta": 0.01917487196624279,
      "rmse_dx": 0.004739595577120781,
      "rmse_dy": 0.0034386576153337955,
      "rmse_mean": 0.009117708541452885,
      "rotation_flip": 0.00193143414799124,
      "sparse_tokens": 32073.0,
      "step": 9135,
      "turn_loss": 0.06333206593990326,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.42445642073963946,
      "grad_norm": 0.4795100688934326,
      "learning_rate": 1.3676717790222e-06,
      "loss": 0.1483,
      "mae_dtheta": 0.008111241273581982,
      "mae_dx": 0.001047304249368608,
      "mae_dy": 0.0021068863570690155,
      "pose_mae_dtheta": 0.04851137846708298,
      "pose_mae_dx": 0.018191801384091377,
      "pose_mae_dy": 0.023024631664156914,
      "pose_rmse_dtheta": 0.09532647579908371,
      "pose_rmse_dx": 0.047169361263513565,
      "pose_rmse_dy": 0.0539623461663723,
      "pose_rmse_mean": 0.06548606604337692,
      "rmse_dtheta": 0.016102876514196396,
      "rmse_dx": 0.003024129895493388,
      "rmse_dy": 0.004579235799610615,
      "rmse_mean": 0.007902081124484539,
      "rotation_flip": 0.0015174506697803736,
      "sparse_tokens": 32089.0,
      "step": 9136,
      "turn_loss": 0.07555773854255676,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.42450288050548224,
      "grad_norm": 0.4563741385936737,
      "learning_rate": 1.366763273369312e-06,
      "loss": 0.1368,
      "mae_dtheta": 0.00934149045497179,
      "mae_dx": 0.0010983564425259829,
      "mae_dy": 0.0026806588284671307,
      "pose_mae_dtheta": 0.06251353770494461,
      "pose_mae_dx": 0.021299272775650024,
      "pose_mae_dy": 0.036013007164001465,
      "pose_rmse_dtheta": 0.1185484454035759,
      "pose_rmse_dx": 0.06282683461904526,
      "pose_rmse_dy": 0.08625898510217667,
      "pose_rmse_mean": 0.08921142667531967,
      "rmse_dtheta": 0.017171218991279602,
      "rmse_dx": 0.0038446446415036917,
      "rmse_dy": 0.005659135058522224,
      "rmse_mean": 0.008891666308045387,
      "rotation_flip": 0.0015704750549048185,
      "sparse_tokens": 32025.0,
      "step": 9137,
      "turn_loss": 0.0760938748717308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.424549340271325,
      "grad_norm": 0.558994710445404,
      "learning_rate": 1.3658550217906175e-06,
      "loss": 0.1337,
      "mae_dtheta": 0.033375076949596405,
      "mae_dx": 0.010189289227128029,
      "mae_dy": 0.004101092461496592,
      "pose_mae_dtheta": 0.25317904353141785,
      "pose_mae_dx": 0.07539781928062439,
      "pose_mae_dy": 0.043427735567092896,
      "pose_rmse_dtheta": 0.4374218285083771,
      "pose_rmse_dx": 0.17185644805431366,
      "pose_rmse_dy": 0.1124800518155098,
      "pose_rmse_mean": 0.24058610200881958,
      "rmse_dtheta": 0.051877688616514206,
      "rmse_dx": 0.021938370540738106,
      "rmse_dy": 0.00930886808782816,
      "rmse_mean": 0.02770831063389778,
      "rotation_flip": 0.01954120583832264,
      "sparse_tokens": 19895.0,
      "step": 9138,
      "turn_loss": 0.25046807527542114,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4245958000371678,
      "grad_norm": 0.5732142329216003,
      "learning_rate": 1.3649470243496327e-06,
      "loss": 0.1397,
      "mae_dtheta": 0.009358979761600494,
      "mae_dx": 0.0010719132842496037,
      "mae_dy": 0.0013878259342163801,
      "pose_mae_dtheta": 0.06304454803466797,
      "pose_mae_dx": 0.012471811845898628,
      "pose_mae_dy": 0.01801859214901924,
      "pose_rmse_dtheta": 0.19162848591804504,
      "pose_rmse_dx": 0.03444686532020569,
      "pose_rmse_dy": 0.048569682985544205,
      "pose_rmse_mean": 0.09154834598302841,
      "rmse_dtheta": 0.024273540824651718,
      "rmse_dx": 0.003198946127668023,
      "rmse_dy": 0.0031503108330070972,
      "rmse_mean": 0.01020759902894497,
      "rotation_flip": 0.005291005130857229,
      "sparse_tokens": 32137.0,
      "step": 9139,
      "turn_loss": 0.07050079107284546,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.42464225980301057,
      "grad_norm": 0.684101402759552,
      "learning_rate": 1.3640392811098524e-06,
      "loss": 0.1204,
      "mae_dtheta": 0.009354774840176105,
      "mae_dx": 0.0012672320008277893,
      "mae_dy": 0.0017295125871896744,
      "pose_mae_dtheta": 0.05744653195142746,
      "pose_mae_dx": 0.015505296178162098,
      "pose_mae_dy": 0.020428160205483437,
      "pose_rmse_dtheta": 0.13543426990509033,
      "pose_rmse_dx": 0.04100869968533516,
      "pose_rmse_dy": 0.04491401091217995,
      "pose_rmse_mean": 0.07378566265106201,
      "rmse_dtheta": 0.020408619195222855,
      "rmse_dx": 0.004294258542358875,
      "rmse_dy": 0.003502274863421917,
      "rmse_mean": 0.009401718154549599,
      "rotation_flip": 0.003345724893733859,
      "sparse_tokens": 32153.0,
      "step": 9140,
      "turn_loss": 0.07557396590709686,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.42468871956885335,
      "grad_norm": 0.45723018050193787,
      "learning_rate": 1.3631317921347564e-06,
      "loss": 0.0771,
      "mae_dtheta": 0.011479856446385384,
      "mae_dx": 0.0017127718310803175,
      "mae_dy": 0.002558251144364476,
      "pose_mae_dtheta": 0.0799158439040184,
      "pose_mae_dx": 0.02049616165459156,
      "pose_mae_dy": 0.031074579805135727,
      "pose_rmse_dtheta": 0.21069647371768951,
      "pose_rmse_dx": 0.05247420445084572,
      "pose_rmse_dy": 0.08476594090461731,
      "pose_rmse_mean": 0.11597888171672821,
      "rmse_dtheta": 0.024797789752483368,
      "rmse_dx": 0.007066571619361639,
      "rmse_dy": 0.006547841709107161,
      "rmse_mean": 0.012804067693650723,
      "rotation_flip": 0.004221388138830662,
      "sparse_tokens": 32057.0,
      "step": 9141,
      "turn_loss": 0.08846347779035568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.4247351793346962,
      "grad_norm": 0.9256717562675476,
      "learning_rate": 1.3622245574878079e-06,
      "loss": 0.238,
      "mae_dtheta": 0.0486493855714798,
      "mae_dx": 0.015797803178429604,
      "mae_dy": 0.005174099467694759,
      "pose_mae_dtheta": 0.3905084729194641,
      "pose_mae_dx": 0.12996341288089752,
      "pose_mae_dy": 0.05670550465583801,
      "pose_rmse_dtheta": 0.6132189035415649,
      "pose_rmse_dx": 0.23892100155353546,
      "pose_rmse_dy": 0.11983366310596466,
      "pose_rmse_mean": 0.32399117946624756,
      "rmse_dtheta": 0.06635411083698273,
      "rmse_dx": 0.026861676946282387,
      "rmse_dy": 0.009516426362097263,
      "rmse_mean": 0.03424407169222832,
      "rotation_flip": 0.021021021530032158,
      "sparse_tokens": 5862.0,
      "step": 9142,
      "turn_loss": 0.32725855708122253,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.42478163910053895,
      "grad_norm": 0.6138939261436462,
      "learning_rate": 1.3613175772324471e-06,
      "loss": 0.1342,
      "mae_dtheta": 0.008082924410700798,
      "mae_dx": 0.0018162888009101152,
      "mae_dy": 0.0013751384103670716,
      "pose_mae_dtheta": 0.05806903541088104,
      "pose_mae_dx": 0.018089305609464645,
      "pose_mae_dy": 0.01422078162431717,
      "pose_rmse_dtheta": 0.18876250088214874,
      "pose_rmse_dx": 0.0571928396821022,
      "pose_rmse_dy": 0.039422132074832916,
      "pose_rmse_mean": 0.09512582421302795,
      "rmse_dtheta": 0.0239696241915226,
      "rmse_dx": 0.005636835936456919,
      "rmse_dy": 0.004080089274793863,
      "rmse_mean": 0.011228850111365318,
      "rotation_flip": 0.0009760858956724405,
      "sparse_tokens": 32153.0,
      "step": 9143,
      "turn_loss": 0.06736104190349579,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.42482809886638173,
      "grad_norm": 0.7650637030601501,
      "learning_rate": 1.3604108514321029e-06,
      "loss": 0.1251,
      "mae_dtheta": 0.005721233785152435,
      "mae_dx": 0.0014215536648407578,
      "mae_dy": 0.000917442434001714,
      "pose_mae_dtheta": 0.04090327024459839,
      "pose_mae_dx": 0.013246568851172924,
      "pose_mae_dy": 0.012009474448859692,
      "pose_rmse_dtheta": 0.11092925071716309,
      "pose_rmse_dx": 0.040111467242240906,
      "pose_rmse_dy": 0.03481404483318329,
      "pose_rmse_mean": 0.061951588839292526,
      "rmse_dtheta": 0.01459017489105463,
      "rmse_dx": 0.00547709409147501,
      "rmse_dy": 0.0022288893815129995,
      "rmse_mean": 0.007432052865624428,
      "rotation_flip": 0.0032822757493704557,
      "sparse_tokens": 32105.0,
      "step": 9144,
      "turn_loss": 0.05003978684544563,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.4248745586322245,
      "grad_norm": 1.2010453939437866,
      "learning_rate": 1.3595043801501794e-06,
      "loss": 0.2589,
      "mae_dtheta": 0.033843036741018295,
      "mae_dx": 0.019022254273295403,
      "mae_dy": 0.003816849086433649,
      "pose_mae_dtheta": 0.27933552861213684,
      "pose_mae_dx": 0.1672220230102539,
      "pose_mae_dy": 0.03123372420668602,
      "pose_rmse_dtheta": 0.494808167219162,
      "pose_rmse_dx": 0.33267292380332947,
      "pose_rmse_dy": 0.06446896493434906,
      "pose_rmse_mean": 0.29731670022010803,
      "rmse_dtheta": 0.05352836102247238,
      "rmse_dx": 0.03287181630730629,
      "rmse_dy": 0.009471859782934189,
      "rmse_mean": 0.03195735067129135,
      "rotation_flip": 0.0069204154424369335,
      "sparse_tokens": 5126.0,
      "step": 9145,
      "turn_loss": 0.22209112346172333,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.4249210183980673,
      "grad_norm": 0.5244728922843933,
      "learning_rate": 1.3585981634500688e-06,
      "loss": 0.1158,
      "mae_dtheta": 0.03062254935503006,
      "mae_dx": 0.007811799179762602,
      "mae_dy": 0.005620711017400026,
      "pose_mae_dtheta": 0.2662418484687805,
      "pose_mae_dx": 0.07722465693950653,
      "pose_mae_dy": 0.04384729266166687,
      "pose_rmse_dtheta": 0.5406653881072998,
      "pose_rmse_dx": 0.17436306178569794,
      "pose_rmse_dy": 0.09589888900518417,
      "pose_rmse_mean": 0.27030912041664124,
      "rmse_dtheta": 0.05351884290575981,
      "rmse_dx": 0.017568141222000122,
      "rmse_dy": 0.01309971883893013,
      "rmse_mean": 0.028062235563993454,
      "rotation_flip": 0.005802707746624947,
      "sparse_tokens": 7861.0,
      "step": 9146,
      "turn_loss": 0.27068328857421875,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.42496747816391006,
      "grad_norm": 0.47097864747047424,
      "learning_rate": 1.3576922013951448e-06,
      "loss": 0.1464,
      "mae_dtheta": 0.01390585396438837,
      "mae_dx": 0.0021645098458975554,
      "mae_dy": 0.0030008696485310793,
      "pose_mae_dtheta": 0.08974092453718185,
      "pose_mae_dx": 0.021066032350063324,
      "pose_mae_dy": 0.027597885578870773,
      "pose_rmse_dtheta": 0.22828887403011322,
      "pose_rmse_dx": 0.045979104936122894,
      "pose_rmse_dy": 0.05663738027215004,
      "pose_rmse_mean": 0.11030178517103195,
      "rmse_dtheta": 0.030519958585500717,
      "rmse_dx": 0.005969855934381485,
      "rmse_dy": 0.007425486110150814,
      "rmse_mean": 0.014638434164226055,
      "rotation_flip": 0.00699300691485405,
      "sparse_tokens": 32153.0,
      "step": 9147,
      "turn_loss": 0.1181778758764267,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.42501393792975284,
      "grad_norm": 0.40556633472442627,
      "learning_rate": 1.3567864940487586e-06,
      "loss": 0.0902,
      "mae_dtheta": 0.007215450517833233,
      "mae_dx": 0.0011433844920247793,
      "mae_dy": 0.0006438306299969554,
      "pose_mae_dtheta": 0.05066434293985367,
      "pose_mae_dx": 0.008830529637634754,
      "pose_mae_dy": 0.009250587783753872,
      "pose_rmse_dtheta": 0.18454866111278534,
      "pose_rmse_dx": 0.019145430997014046,
      "pose_rmse_dy": 0.024951105937361717,
      "pose_rmse_mean": 0.07621506601572037,
      "rmse_dtheta": 0.024219073355197906,
      "rmse_dx": 0.00317589589394629,
      "rmse_dy": 0.001282638288103044,
      "rmse_mean": 0.009559202939271927,
      "rotation_flip": 0.0021132712718099356,
      "sparse_tokens": 32201.0,
      "step": 9148,
      "turn_loss": 0.040415532886981964,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33413.0,
      "epoch": 0.4250603976955956,
      "grad_norm": 0.5112496614456177,
      "learning_rate": 1.3558810414742497e-06,
      "loss": 0.1786,
      "mae_dtheta": 0.03373152017593384,
      "mae_dx": 0.0114909578114748,
      "mae_dy": 0.006087965797632933,
      "pose_mae_dtheta": 0.2579762041568756,
      "pose_mae_dx": 0.08410175144672394,
      "pose_mae_dy": 0.06758314371109009,
      "pose_rmse_dtheta": 0.4411126375198364,
      "pose_rmse_dx": 0.1960025280714035,
      "pose_rmse_dy": 0.15985837578773499,
      "pose_rmse_mean": 0.26565787196159363,
      "rmse_dtheta": 0.05066877603530884,
      "rmse_dx": 0.02362976409494877,
      "rmse_dy": 0.012238356284797192,
      "rmse_mean": 0.02884563058614731,
      "rotation_flip": 0.01630094088613987,
      "sparse_tokens": 25316.0,
      "step": 9149,
      "turn_loss": 0.29425838589668274,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 43354.0,
      "epoch": 0.4251068574614384,
      "grad_norm": 0.7086357474327087,
      "learning_rate": 1.3549758437349337e-06,
      "loss": 0.2091,
      "mae_dtheta": 0.043023817241191864,
      "mae_dx": 0.009686943143606186,
      "mae_dy": 0.003988177515566349,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7086357474327087,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.05514526367188,
      "model/head/act_norm_mean": 98.81002215485074,
      "model/head/act_norm_min": 68.72179412841797,
      "model/head/act_over_embed": 67.90317229881562,
      "model/head/grad_frac": 0.1138506755232811,
      "model/head/grad_norm": 0.08067865669727325,
      "model/head/grad_zero_frac": 0.0001792585535440594,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6977174673507462,
      "model/head/update_ratio": 0.0013737913686782122,
      "model/head/weight_delta": 9.877290725708008,
      "model/head/weight_delta_rel": 0.17327693104743958,
      "model/head/weight_norm": 58.72700881958008,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42257705330848694,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42257705330848694,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42257705330848694,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2903989072622967,
      "model/modality_embedder.encoders.pose/grad_frac": 0.04074555262923241,
      "model/modality_embedder.encoders.pose/grad_norm": 0.028873754665255547,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009323543054051697,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1354241371154785,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10244408249855042,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968650817871094,
      "model/modality_embedder/grad_frac": 0.04074555262923241,
      "model/modality_embedder/grad_norm": 0.028873754665255547,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0009323543054051697,
      "model/modality_embedder/weight_delta": 3.1354241371154785,
      "model/modality_embedder/weight_delta_rel": 0.10244408249855042,
      "model/modality_embedder/weight_norm": 30.968650817871094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.7098617553711,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.61117033878228,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.252265930175781,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.538607945923111,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.13289780914783478,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.09417613595724106,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0033696279861032963,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.685774087905884,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09787122905254364,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.94852638244629,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.4277572631836,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.366171375266525,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.815445899963379,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.05745172662615,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.13151369988918304,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.09319531172513962,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0031325803138315678,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4049932956695557,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11795163154602051,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.750333786010742,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.27815246582031,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.932745128524047,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.07650089263916,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.134015876359275,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.14815466105937958,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.10498768836259842,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.003417525440454483,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6858363151550293,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12376347929239273,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.720382690429688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.15786743164062,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.80291992418858,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.003907203674316,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.419217504792233,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.14185397326946259,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.10052280128002167,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 9.0784378699027e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0033576732967048883,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1640560626983643,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10813242197036743,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.938232421875,
      "model/normalizer/grad_frac": 0.5719379186630249,
      "model/normalizer/grad_norm": 0.4052956700325012,
      "model/normalizer/grad_zero_frac": 0.0001559894735692069,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.005154138896614313,
      "model/normalizer/weight_delta": 6.663384914398193,
      "model/normalizer/weight_delta_rel": 0.08582054078578949,
      "model/normalizer/weight_norm": 78.63499450683594,
      "pose_mae_dtheta": 0.3611782193183899,
      "pose_mae_dx": 0.07760997861623764,
      "pose_mae_dy": 0.04100043699145317,
      "pose_rmse_dtheta": 0.5844810009002686,
      "pose_rmse_dx": 0.19028010964393616,
      "pose_rmse_dy": 0.10805267095565796,
      "pose_rmse_mean": 0.2942712604999542,
      "rmse_dtheta": 0.061127886176109314,
      "rmse_dx": 0.02109592780470848,
      "rmse_dy": 0.008887958712875843,
      "rmse_mean": 0.030370593070983887,
      "rotation_flip": 0.01901312731206417,
      "sparse_tokens": 29948.0,
      "step": 9150,
      "turn_loss": 0.305560439825058,
      "turns": 134.0,
      "turns_per_sample": 134.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.42515331722728117,
      "grad_norm": 0.6203270554542542,
      "learning_rate": 1.354070900894115e-06,
      "loss": 0.1674,
      "mae_dtheta": 0.01091114804148674,
      "mae_dx": 0.0016671550692990422,
      "mae_dy": 0.0014840227086097002,
      "pose_mae_dtheta": 0.07339441776275635,
      "pose_mae_dx": 0.019602660089731216,
      "pose_mae_dy": 0.021590938791632652,
      "pose_rmse_dtheta": 0.19667871296405792,
      "pose_rmse_dx": 0.04782336950302124,
      "pose_rmse_dy": 0.054897770285606384,
      "pose_rmse_mean": 0.09979995340108871,
      "rmse_dtheta": 0.02637302130460739,
      "rmse_dx": 0.005277601070702076,
      "rmse_dy": 0.0031435154378414154,
      "rmse_mean": 0.011598045937716961,
      "rotation_flip": 0.003054101252928376,
      "sparse_tokens": 32121.0,
      "step": 9151,
      "turn_loss": 0.06691062450408936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.42519977699312395,
      "grad_norm": 0.43876171112060547,
      "learning_rate": 1.3531662130150735e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.00600457563996315,
      "mae_dx": 0.0010010433616116643,
      "mae_dy": 0.0009137730812653899,
      "pose_mae_dtheta": 0.04709239676594734,
      "pose_mae_dx": 0.011380866169929504,
      "pose_mae_dy": 0.01797381602227688,
      "pose_rmse_dtheta": 0.15833821892738342,
      "pose_rmse_dx": 0.033491577953100204,
      "pose_rmse_dy": 0.05935175344347954,
      "pose_rmse_mean": 0.08372718095779419,
      "rmse_dtheta": 0.017854230478405952,
      "rmse_dx": 0.00364339048974216,
      "rmse_dy": 0.0023879187647253275,
      "rmse_mean": 0.007961846888065338,
      "rotation_flip": 0.0018393623176962137,
      "sparse_tokens": 32073.0,
      "step": 9152,
      "turn_loss": 0.0456959493458271,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4252462367589667,
      "grad_norm": 0.6695491671562195,
      "learning_rate": 1.3522617801610767e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.007440245244652033,
      "mae_dx": 0.0015723800752311945,
      "mae_dy": 0.002140198601409793,
      "pose_mae_dtheta": 0.04726910963654518,
      "pose_mae_dx": 0.023085972294211388,
      "pose_mae_dy": 0.021536406129598618,
      "pose_rmse_dtheta": 0.110890232026577,
      "pose_rmse_dx": 0.06451297551393509,
      "pose_rmse_dy": 0.04861586540937424,
      "pose_rmse_mean": 0.07467302680015564,
      "rmse_dtheta": 0.016636626794934273,
      "rmse_dx": 0.004681591410189867,
      "rmse_dy": 0.005028067622333765,
      "rmse_mean": 0.008782095275819302,
      "rotation_flip": 0.002422285033389926,
      "sparse_tokens": 32073.0,
      "step": 9153,
      "turn_loss": 0.06533946096897125,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4252926965248095,
      "grad_norm": 0.4187313914299011,
      "learning_rate": 1.3513576023953724e-06,
      "loss": 0.1025,
      "mae_dtheta": 0.011971695348620415,
      "mae_dx": 0.00227101007476449,
      "mae_dy": 0.0035661086440086365,
      "pose_mae_dtheta": 0.07982990145683289,
      "pose_mae_dx": 0.03237604722380638,
      "pose_mae_dy": 0.0326307974755764,
      "pose_rmse_dtheta": 0.1988447904586792,
      "pose_rmse_dx": 0.09221499413251877,
      "pose_rmse_dy": 0.07002344727516174,
      "pose_rmse_mean": 0.1203610822558403,
      "rmse_dtheta": 0.025690322741866112,
      "rmse_dx": 0.006457857321947813,
      "rmse_dy": 0.008214365690946579,
      "rmse_mean": 0.01345418207347393,
      "rotation_flip": 0.00682302750647068,
      "sparse_tokens": 32057.0,
      "step": 9154,
      "turn_loss": 0.10171859711408615,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4253391562906523,
      "grad_norm": 0.4819016456604004,
      "learning_rate": 1.3504536797811878e-06,
      "loss": 0.0839,
      "mae_dtheta": 0.008900532498955727,
      "mae_dx": 0.001565133105032146,
      "mae_dy": 0.0021358225494623184,
      "pose_mae_dtheta": 0.06556959450244904,
      "pose_mae_dx": 0.017536194995045662,
      "pose_mae_dy": 0.02095009759068489,
      "pose_rmse_dtheta": 0.18688660860061646,
      "pose_rmse_dx": 0.04783225059509277,
      "pose_rmse_dy": 0.0578085333108902,
      "pose_rmse_mean": 0.09750913083553314,
      "rmse_dtheta": 0.023536253720521927,
      "rmse_dx": 0.005077545531094074,
      "rmse_dy": 0.005487326066941023,
      "rmse_mean": 0.011367041617631912,
      "rotation_flip": 0.0032482598908245564,
      "sparse_tokens": 32073.0,
      "step": 9155,
      "turn_loss": 0.06765618920326233,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.42538561605649505,
      "grad_norm": 0.7802745699882507,
      "learning_rate": 1.349550012381738e-06,
      "loss": 0.2298,
      "mae_dtheta": 0.032354094088077545,
      "mae_dx": 0.007639645598828793,
      "mae_dy": 0.0035053491592407227,
      "pose_mae_dtheta": 0.2463621348142624,
      "pose_mae_dx": 0.05732991546392441,
      "pose_mae_dy": 0.03904907777905464,
      "pose_rmse_dtheta": 0.42232459783554077,
      "pose_rmse_dx": 0.11749698221683502,
      "pose_rmse_dy": 0.14217005670070648,
      "pose_rmse_mean": 0.2273305505514145,
      "rmse_dtheta": 0.050161559134721756,
      "rmse_dx": 0.01730884425342083,
      "rmse_dy": 0.010951630771160126,
      "rmse_mean": 0.02614067867398262,
      "rotation_flip": 0.020935960114002228,
      "sparse_tokens": 12404.0,
      "step": 9156,
      "turn_loss": 0.23424328863620758,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 34930.0,
      "epoch": 0.42543207582233783,
      "grad_norm": 0.569198489189148,
      "learning_rate": 1.3486466002602133e-06,
      "loss": 0.123,
      "mae_dtheta": 0.042638882994651794,
      "mae_dx": 0.013725558295845985,
      "mae_dy": 0.005174119491130114,
      "pose_mae_dtheta": 0.3328905999660492,
      "pose_mae_dx": 0.10828064382076263,
      "pose_mae_dy": 0.06577328592538834,
      "pose_rmse_dtheta": 0.5602105855941772,
      "pose_rmse_dx": 0.22993303835391998,
      "pose_rmse_dy": 0.15970465540885925,
      "pose_rmse_mean": 0.31661611795425415,
      "rmse_dtheta": 0.061430830508470535,
      "rmse_dx": 0.02623922750353813,
      "rmse_dy": 0.010469372384250164,
      "rmse_mean": 0.0327131450176239,
      "rotation_flip": 0.020395921543240547,
      "sparse_tokens": 26400.0,
      "step": 9157,
      "turn_loss": 0.2935127317905426,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 17536.0,
      "epoch": 0.42547853558818066,
      "grad_norm": 0.3891705870628357,
      "learning_rate": 1.347743443479793e-06,
      "loss": 0.1081,
      "mae_dtheta": 0.025573331862688065,
      "mae_dx": 0.007236318197101355,
      "mae_dy": 0.00581883080303669,
      "pose_mae_dtheta": 0.18045227229595184,
      "pose_mae_dx": 0.07304868847131729,
      "pose_mae_dy": 0.0769757404923439,
      "pose_rmse_dtheta": 0.36925774812698364,
      "pose_rmse_dx": 0.17342935502529144,
      "pose_rmse_dy": 0.1667223423719406,
      "pose_rmse_mean": 0.2364698350429535,
      "rmse_dtheta": 0.04315043240785599,
      "rmse_dx": 0.01796923205256462,
      "rmse_dy": 0.010963795706629753,
      "rmse_mean": 0.02402782067656517,
      "rotation_flip": 0.013071895577013493,
      "sparse_tokens": 14352.0,
      "step": 9158,
      "turn_loss": 0.20503750443458557,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 13973.0,
      "epoch": 0.42552499535402344,
      "grad_norm": 0.6373606324195862,
      "learning_rate": 1.3468405421036329e-06,
      "loss": 0.1445,
      "mae_dtheta": 0.03720187768340111,
      "mae_dx": 0.008859492838382721,
      "mae_dy": 0.006525229196995497,
      "pose_mae_dtheta": 0.2850286364555359,
      "pose_mae_dx": 0.07810330390930176,
      "pose_mae_dy": 0.0679987296462059,
      "pose_rmse_dtheta": 0.5328391790390015,
      "pose_rmse_dx": 0.1823175996541977,
      "pose_rmse_dy": 0.1709749847650528,
      "pose_rmse_mean": 0.295377254486084,
      "rmse_dtheta": 0.05762772634625435,
      "rmse_dx": 0.01926802657544613,
      "rmse_dy": 0.015439140610396862,
      "rmse_mean": 0.030778296291828156,
      "rotation_flip": 0.014662756584584713,
      "sparse_tokens": 11534.0,
      "step": 9159,
      "turn_loss": 0.2912920117378235,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4255714551198662,
      "grad_norm": 0.6158664226531982,
      "learning_rate": 1.3459378961948743e-06,
      "loss": 0.1427,
      "mae_dtheta": 0.008552874438464642,
      "mae_dx": 0.0016391398385167122,
      "mae_dy": 0.001953495666384697,
      "pose_mae_dtheta": 0.05583471059799194,
      "pose_mae_dx": 0.020388871431350708,
      "pose_mae_dy": 0.02280707098543644,
      "pose_rmse_dtheta": 0.12219014018774033,
      "pose_rmse_dx": 0.046531785279512405,
      "pose_rmse_dy": 0.051719486713409424,
      "pose_rmse_mean": 0.07348047196865082,
      "rmse_dtheta": 0.01883748732507229,
      "rmse_dx": 0.0047765132039785385,
      "rmse_dy": 0.004193584434688091,
      "rmse_mean": 0.00926919560879469,
      "rotation_flip": 0.005329272709786892,
      "sparse_tokens": 32121.0,
      "step": 9160,
      "turn_loss": 0.06298959255218506,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.425617914885709,
      "grad_norm": 0.4195351302623749,
      "learning_rate": 1.345035505816642e-06,
      "loss": 0.1064,
      "mae_dtheta": 0.033382318913936615,
      "mae_dx": 0.01104478444904089,
      "mae_dy": 0.0040517644956707954,
      "pose_mae_dtheta": 0.26450350880622864,
      "pose_mae_dx": 0.08810516446828842,
      "pose_mae_dy": 0.05417177826166153,
      "pose_rmse_dtheta": 0.525284469127655,
      "pose_rmse_dx": 0.2119484841823578,
      "pose_rmse_dy": 0.12693454325199127,
      "pose_rmse_mean": 0.2880558371543884,
      "rmse_dtheta": 0.053124263882637024,
      "rmse_dx": 0.02363513968884945,
      "rmse_dy": 0.007735454011708498,
      "rmse_mean": 0.028164952993392944,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 22566.0,
      "step": 9161,
      "turn_loss": 0.22527700662612915,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.42566437465155177,
      "grad_norm": 0.6073182225227356,
      "learning_rate": 1.3441333710320365e-06,
      "loss": 0.1252,
      "mae_dtheta": 0.0098042581230402,
      "mae_dx": 0.0017408357234671712,
      "mae_dy": 0.0022040028125047684,
      "pose_mae_dtheta": 0.06686652451753616,
      "pose_mae_dx": 0.014816230162978172,
      "pose_mae_dy": 0.021666552871465683,
      "pose_rmse_dtheta": 0.18758061528205872,
      "pose_rmse_dx": 0.03536631911993027,
      "pose_rmse_dy": 0.05193422734737396,
      "pose_rmse_mean": 0.09162706136703491,
      "rmse_dtheta": 0.023710506036877632,
      "rmse_dx": 0.006161269266158342,
      "rmse_dy": 0.006421578582376242,
      "rmse_mean": 0.012097785249352455,
      "rotation_flip": 0.0053322394378483295,
      "sparse_tokens": 32105.0,
      "step": 9162,
      "turn_loss": 0.09369523823261261,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.42571083441739455,
      "grad_norm": 0.47960227727890015,
      "learning_rate": 1.3432314919041478e-06,
      "loss": 0.1046,
      "mae_dtheta": 0.007049838081002235,
      "mae_dx": 0.0010123843094334006,
      "mae_dy": 0.0010030020494014025,
      "pose_mae_dtheta": 0.04955416917800903,
      "pose_mae_dx": 0.010969923809170723,
      "pose_mae_dy": 0.013040727935731411,
      "pose_rmse_dtheta": 0.18956543505191803,
      "pose_rmse_dx": 0.026555931195616722,
      "pose_rmse_dy": 0.03369173780083656,
      "pose_rmse_mean": 0.08327103406190872,
      "rmse_dtheta": 0.02226918376982212,
      "rmse_dx": 0.0029942740220576525,
      "rmse_dy": 0.002082685474306345,
      "rmse_mean": 0.00911538116633892,
      "rotation_flip": 0.0022914756555110216,
      "sparse_tokens": 32153.0,
      "step": 9163,
      "turn_loss": 0.04341274872422218,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4257572941832373,
      "grad_norm": 0.4419694244861603,
      "learning_rate": 1.342329868496044e-06,
      "loss": 0.0791,
      "mae_dtheta": 0.007244415115565062,
      "mae_dx": 0.0017421402735635638,
      "mae_dy": 0.0007648098398931324,
      "pose_mae_dtheta": 0.051541250199079514,
      "pose_mae_dx": 0.012942394241690636,
      "pose_mae_dy": 0.008341630920767784,
      "pose_rmse_dtheta": 0.20797954499721527,
      "pose_rmse_dx": 0.04085390269756317,
      "pose_rmse_dy": 0.0415772907435894,
      "pose_rmse_mean": 0.09680357575416565,
      "rmse_dtheta": 0.02492406591773033,
      "rmse_dx": 0.0067922985181212425,
      "rmse_dy": 0.0033239887561649084,
      "rmse_mean": 0.011680117808282375,
      "rotation_flip": 0.002964426763355732,
      "sparse_tokens": 31933.0,
      "step": 9164,
      "turn_loss": 0.04809361323714256,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4258037539490801,
      "grad_norm": 0.46692124009132385,
      "learning_rate": 1.3414285008707738e-06,
      "loss": 0.1066,
      "mae_dtheta": 0.008869095705449581,
      "mae_dx": 0.0035489178262650967,
      "mae_dy": 0.0006715492927469313,
      "pose_mae_dtheta": 0.059997592121362686,
      "pose_mae_dx": 0.03368193283677101,
      "pose_mae_dy": 0.009851769544184208,
      "pose_rmse_dtheta": 0.2441362738609314,
      "pose_rmse_dx": 0.0994892418384552,
      "pose_rmse_dy": 0.03197680786252022,
      "pose_rmse_mean": 0.1252007782459259,
      "rmse_dtheta": 0.029772209003567696,
      "rmse_dx": 0.01091716717928648,
      "rmse_dy": 0.002140084281563759,
      "rmse_mean": 0.01427648775279522,
      "rotation_flip": 0.00109349365811795,
      "sparse_tokens": 32185.0,
      "step": 9165,
      "turn_loss": 0.10109177976846695,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4258502137149229,
      "grad_norm": 0.47120869159698486,
      "learning_rate": 1.340527389091374e-06,
      "loss": 0.1079,
      "mae_dtheta": 0.006566300988197327,
      "mae_dx": 0.0013027065433561802,
      "mae_dy": 0.0012243069941177964,
      "pose_mae_dtheta": 0.043423231691122055,
      "pose_mae_dx": 0.013814602047204971,
      "pose_mae_dy": 0.015118231065571308,
      "pose_rmse_dtheta": 0.12975983321666718,
      "pose_rmse_dx": 0.03242025524377823,
      "pose_rmse_dy": 0.04404371976852417,
      "pose_rmse_mean": 0.06874127686023712,
      "rmse_dtheta": 0.0188871119171381,
      "rmse_dx": 0.0038344701752066612,
      "rmse_dy": 0.0030982668977230787,
      "rmse_mean": 0.008606616407632828,
      "rotation_flip": 0.004384216852486134,
      "sparse_tokens": 32201.0,
      "step": 9166,
      "turn_loss": 0.0505920946598053,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6521.0,
      "epoch": 0.42589667348076565,
      "grad_norm": 0.535987913608551,
      "learning_rate": 1.339626533220857e-06,
      "loss": 0.1497,
      "mae_dtheta": 0.0420122854411602,
      "mae_dx": 0.010968715883791447,
      "mae_dy": 0.009811941534280777,
      "pose_mae_dtheta": 0.35864385962486267,
      "pose_mae_dx": 0.09991592913866043,
      "pose_mae_dy": 0.08997809141874313,
      "pose_rmse_dtheta": 0.6675560474395752,
      "pose_rmse_dx": 0.2546023428440094,
      "pose_rmse_dy": 0.22166307270526886,
      "pose_rmse_mean": 0.3812738358974457,
      "rmse_dtheta": 0.06641057133674622,
      "rmse_dx": 0.023141497746109962,
      "rmse_dy": 0.021356068551540375,
      "rmse_mean": 0.0369693785905838,
      "rotation_flip": 0.02024291455745697,
      "sparse_tokens": 5632.0,
      "step": 9167,
      "turn_loss": 0.2704222798347473,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.42594313324660843,
      "grad_norm": 0.6285119652748108,
      "learning_rate": 1.3387259333222219e-06,
      "loss": 0.1366,
      "mae_dtheta": 0.0257178395986557,
      "mae_dx": 0.012127476744353771,
      "mae_dy": 0.0033878444228321314,
      "pose_mae_dtheta": 0.22027532756328583,
      "pose_mae_dx": 0.08306501805782318,
      "pose_mae_dy": 0.04309776797890663,
      "pose_rmse_dtheta": 0.41419216990470886,
      "pose_rmse_dx": 0.19920560717582703,
      "pose_rmse_dy": 0.14882440865039825,
      "pose_rmse_mean": 0.2540740668773651,
      "rmse_dtheta": 0.04373832792043686,
      "rmse_dx": 0.024528276175260544,
      "rmse_dy": 0.009667028672993183,
      "rmse_mean": 0.025977877900004387,
      "rotation_flip": 0.013568521477282047,
      "sparse_tokens": 13442.0,
      "step": 9168,
      "turn_loss": 0.211401104927063,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4259895930124512,
      "grad_norm": 0.5606400966644287,
      "learning_rate": 1.3378255894584463e-06,
      "loss": 0.1679,
      "mae_dtheta": 0.011401412077248096,
      "mae_dx": 0.0014257810544222593,
      "mae_dy": 0.0020170616917312145,
      "pose_mae_dtheta": 0.08156023919582367,
      "pose_mae_dx": 0.015305466949939728,
      "pose_mae_dy": 0.02343914285302162,
      "pose_rmse_dtheta": 0.2533009350299835,
      "pose_rmse_dx": 0.03757821023464203,
      "pose_rmse_dy": 0.06002979353070259,
      "pose_rmse_mean": 0.11696964502334595,
      "rmse_dtheta": 0.028351416811347008,
      "rmse_dx": 0.004697435535490513,
      "rmse_dy": 0.005648230202496052,
      "rmse_mean": 0.01289902813732624,
      "rotation_flip": 0.005446166731417179,
      "sparse_tokens": 32089.0,
      "step": 9169,
      "turn_loss": 0.0745919942855835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.426036052778294,
      "grad_norm": 0.5745965242385864,
      "learning_rate": 1.3369255016924943e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.011084716767072678,
      "mae_dx": 0.0012548945378512144,
      "mae_dy": 0.0024718535132706165,
      "pose_mae_dtheta": 0.08262364566326141,
      "pose_mae_dx": 0.018894899636507034,
      "pose_mae_dy": 0.032637614756822586,
      "pose_rmse_dtheta": 0.2077847719192505,
      "pose_rmse_dx": 0.05081525072455406,
      "pose_rmse_dy": 0.06988146901130676,
      "pose_rmse_mean": 0.10949383676052094,
      "rmse_dtheta": 0.023316405713558197,
      "rmse_dx": 0.0039345757104456425,
      "rmse_dy": 0.005646738223731518,
      "rmse_mean": 0.010965906083583832,
      "rotation_flip": 0.004297994077205658,
      "sparse_tokens": 32073.0,
      "step": 9170,
      "turn_loss": 0.08296625316143036,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.42608251254413676,
      "grad_norm": 0.472687304019928,
      "learning_rate": 1.3360256700873064e-06,
      "loss": 0.1295,
      "mae_dtheta": 0.03670630231499672,
      "mae_dx": 0.014124545268714428,
      "mae_dy": 0.005858925636857748,
      "pose_mae_dtheta": 0.29090115427970886,
      "pose_mae_dx": 0.12167193740606308,
      "pose_mae_dy": 0.06742779165506363,
      "pose_rmse_dtheta": 0.482383668422699,
      "pose_rmse_dx": 0.2572973370552063,
      "pose_rmse_dy": 0.1512712985277176,
      "pose_rmse_mean": 0.29698410630226135,
      "rmse_dtheta": 0.052128564566373825,
      "rmse_dx": 0.027340538799762726,
      "rmse_dy": 0.011514337733387947,
      "rmse_mean": 0.03032781183719635,
      "rotation_flip": 0.009532888419926167,
      "sparse_tokens": 17897.0,
      "step": 9171,
      "turn_loss": 0.27759215235710144,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.42612897230997954,
      "grad_norm": 0.6669178605079651,
      "learning_rate": 1.3351260947058098e-06,
      "loss": 0.1826,
      "mae_dtheta": 0.027747290208935738,
      "mae_dx": 0.007636882830411196,
      "mae_dy": 0.0014588875928893685,
      "pose_mae_dtheta": 0.19296711683273315,
      "pose_mae_dx": 0.050563350319862366,
      "pose_mae_dy": 0.018512757495045662,
      "pose_rmse_dtheta": 0.44141459465026855,
      "pose_rmse_dx": 0.17711499333381653,
      "pose_rmse_dy": 0.05619608610868454,
      "pose_rmse_mean": 0.22490856051445007,
      "rmse_dtheta": 0.04884416237473488,
      "rmse_dx": 0.020805835723876953,
      "rmse_dy": 0.0033312831073999405,
      "rmse_mean": 0.024327091872692108,
      "rotation_flip": 0.01433691754937172,
      "sparse_tokens": 5846.0,
      "step": 9172,
      "turn_loss": 0.17362689971923828,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4261754320758223,
      "grad_norm": 0.7302907109260559,
      "learning_rate": 1.3342267756109146e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.012775890529155731,
      "mae_dx": 0.002271078061312437,
      "mae_dy": 0.003974646795541048,
      "pose_mae_dtheta": 0.08130525797605515,
      "pose_mae_dx": 0.034905336797237396,
      "pose_mae_dy": 0.03827386349439621,
      "pose_rmse_dtheta": 0.18125182390213013,
      "pose_rmse_dx": 0.08445091545581818,
      "pose_rmse_dy": 0.0815344974398613,
      "pose_rmse_mean": 0.11574574559926987,
      "rmse_dtheta": 0.02500748075544834,
      "rmse_dx": 0.005328063387423754,
      "rmse_dy": 0.008005937561392784,
      "rmse_mean": 0.012780494056642056,
      "rotation_flip": 0.009105180390179157,
      "sparse_tokens": 32105.0,
      "step": 9173,
      "turn_loss": 0.10793209075927734,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.4262218918416651,
      "grad_norm": 0.3737017810344696,
      "learning_rate": 1.3333277128655065e-06,
      "loss": 0.0942,
      "mae_dtheta": 0.04127950593829155,
      "mae_dx": 0.009426002390682697,
      "mae_dy": 0.004651086404919624,
      "pose_mae_dtheta": 0.34009048342704773,
      "pose_mae_dx": 0.07356064766645432,
      "pose_mae_dy": 0.033814605325460434,
      "pose_rmse_dtheta": 0.5428337454795837,
      "pose_rmse_dx": 0.15698589384555817,
      "pose_rmse_dy": 0.08298745006322861,
      "pose_rmse_mean": 0.2609356939792633,
      "rmse_dtheta": 0.06180702522397041,
      "rmse_dx": 0.019107121974229813,
      "rmse_dy": 0.013729838654398918,
      "rmse_mean": 0.031547997146844864,
      "rotation_flip": 0.014469453133642673,
      "sparse_tokens": 9561.0,
      "step": 9174,
      "turn_loss": 0.3397299647331238,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4262683516075079,
      "grad_norm": 0.6810833215713501,
      "learning_rate": 1.3324289065324608e-06,
      "loss": 0.202,
      "mae_dtheta": 0.014966047368943691,
      "mae_dx": 0.004275529179722071,
      "mae_dy": 0.004617271479219198,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6810832023620605,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 148.57177734375,
      "model/head/act_norm_mean": 94.46681660353535,
      "model/head/act_norm_min": 41.28707504272461,
      "model/head/act_over_embed": 64.91848078222068,
      "model/head/grad_frac": 0.1189517080783844,
      "model/head/grad_norm": 0.08101601153612137,
      "model/head/grad_zero_frac": 0.00017037494399119169,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7128363715277778,
      "model/head/update_ratio": 0.001379525987431407,
      "model/head/weight_delta": 9.880491256713867,
      "model/head/weight_delta_rel": 0.173333078622818,
      "model/head/weight_norm": 58.7274284362793,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.422653466463089,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42258949450847816,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42250221967697144,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.290407456971407,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10968017578125,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07470132410526276,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.4921086743273543,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002412150613963604,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1353774070739746,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10244255512952805,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968765258789062,
      "model/modality_embedder/grad_frac": 0.10968017578125,
      "model/modality_embedder/grad_norm": 0.07470132410526276,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.4921086743273543,
      "model/modality_embedder/update_ratio": 0.002412150613963604,
      "model/modality_embedder/weight_delta": 3.1353774070739746,
      "model/modality_embedder/weight_delta_rel": 0.10244255512952805,
      "model/modality_embedder/weight_norm": 30.968765258789062,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.10466003417969,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.18600438912939,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.03118896484375,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.246429924855311,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08199135214090347,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05584293231368065,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019980394281446934,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6873724460601807,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0979294702410698,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.948863983154297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.93190002441406,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.105542027417027,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.469223976135254,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.878344798733579,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08316998928785324,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05664568394422531,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019039895851165056,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.406992197036743,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11802086979150772,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.751047134399414,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.80787658691406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.941651134359468,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.56108570098877,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.140136166948714,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08115905523300171,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05527606979012489,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017992849461734295,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.688032865524292,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12383724004030228,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.721132278442383,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.63995361328125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.866985830527497,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.159438133239746,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.463244195422803,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08734472095966339,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05948902294039726,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0019870128016918898,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.165929079055786,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1081964299082756,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.938922882080078,
      "model/normalizer/grad_frac": 0.34834420680999756,
      "model/normalizer/grad_norm": 0.2372513860464096,
      "model/normalizer/grad_zero_frac": 0.00020444074471015483,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0030170916579663754,
      "model/normalizer/weight_delta": 6.667312145233154,
      "model/normalizer/weight_delta_rel": 0.085871122777462,
      "model/normalizer/weight_norm": 78.63578796386719,
      "pose_mae_dtheta": 0.10300259292125702,
      "pose_mae_dx": 0.04761195182800293,
      "pose_mae_dy": 0.04759659618139267,
      "pose_rmse_dtheta": 0.23003782331943512,
      "pose_rmse_dx": 0.11012083292007446,
      "pose_rmse_dy": 0.11128156632184982,
      "pose_rmse_mean": 0.15048007667064667,
      "rmse_dtheta": 0.029441947117447853,
      "rmse_dx": 0.010636033490300179,
      "rmse_dy": 0.010713750496506691,
      "rmse_mean": 0.016930578276515007,
      "rotation_flip": 0.008008737117052078,
      "sparse_tokens": 32105.0,
      "step": 9175,
      "turn_loss": 0.1575051248073578,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.4263148113733507,
      "grad_norm": 0.789320707321167,
      "learning_rate": 1.331530356674629e-06,
      "loss": 0.2221,
      "mae_dtheta": 0.028431899845600128,
      "mae_dx": 0.01405538059771061,
      "mae_dy": 0.003978297580033541,
      "pose_mae_dtheta": 0.21704469621181488,
      "pose_mae_dx": 0.11308405548334122,
      "pose_mae_dy": 0.04429101198911667,
      "pose_rmse_dtheta": 0.37527450919151306,
      "pose_rmse_dx": 0.21910689771175385,
      "pose_rmse_dy": 0.10590925067663193,
      "pose_rmse_mean": 0.23343020677566528,
      "rmse_dtheta": 0.044811781495809555,
      "rmse_dx": 0.026266753673553467,
      "rmse_dy": 0.0067744627594947815,
      "rmse_mean": 0.025951001793146133,
      "rotation_flip": 0.00856793113052845,
      "sparse_tokens": 14804.0,
      "step": 9176,
      "turn_loss": 0.26626086235046387,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4263612711391935,
      "grad_norm": 0.4468061923980713,
      "learning_rate": 1.3306320633548502e-06,
      "loss": 0.0986,
      "mae_dtheta": 0.0070548634976148605,
      "mae_dx": 0.0011727806413546205,
      "mae_dy": 0.0008494536741636693,
      "pose_mae_dtheta": 0.05397283285856247,
      "pose_mae_dx": 0.010119618847966194,
      "pose_mae_dy": 0.012473225593566895,
      "pose_rmse_dtheta": 0.20964068174362183,
      "pose_rmse_dx": 0.025612052530050278,
      "pose_rmse_dy": 0.0394698865711689,
      "pose_rmse_mean": 0.09157421439886093,
      "rmse_dtheta": 0.022361956536769867,
      "rmse_dx": 0.0038774150889366865,
      "rmse_dy": 0.002240563742816448,
      "rmse_mean": 0.009493311867117882,
      "rotation_flip": 0.004043905064463615,
      "sparse_tokens": 32105.0,
      "step": 9177,
      "turn_loss": 0.045898400247097015,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.42640773090503625,
      "grad_norm": 0.4998491406440735,
      "learning_rate": 1.3297340266359387e-06,
      "loss": 0.1009,
      "mae_dtheta": 0.05397500842809677,
      "mae_dx": 0.010552634485065937,
      "mae_dy": 0.005264804232865572,
      "pose_mae_dtheta": 0.45380303263664246,
      "pose_mae_dx": 0.08467292040586472,
      "pose_mae_dy": 0.04753103852272034,
      "pose_rmse_dtheta": 0.7152391672134399,
      "pose_rmse_dx": 0.20564770698547363,
      "pose_rmse_dy": 0.1416475772857666,
      "pose_rmse_mean": 0.35417816042900085,
      "rmse_dtheta": 0.07327688485383987,
      "rmse_dx": 0.02250523492693901,
      "rmse_dy": 0.013651121407747269,
      "rmse_mean": 0.036477744579315186,
      "rotation_flip": 0.01923076994717121,
      "sparse_tokens": 11572.0,
      "step": 9178,
      "turn_loss": 0.34010714292526245,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.42645419067087903,
      "grad_norm": 0.6062371730804443,
      "learning_rate": 1.328836246580697e-06,
      "loss": 0.0997,
      "mae_dtheta": 0.00905840378254652,
      "mae_dx": 0.0012339171953499317,
      "mae_dy": 0.002431074855849147,
      "pose_mae_dtheta": 0.05596353858709335,
      "pose_mae_dx": 0.018518995493650436,
      "pose_mae_dy": 0.02480408549308777,
      "pose_rmse_dtheta": 0.11204381287097931,
      "pose_rmse_dx": 0.05262970179319382,
      "pose_rmse_dy": 0.05595531687140465,
      "pose_rmse_mean": 0.07354294508695602,
      "rmse_dtheta": 0.017172055318951607,
      "rmse_dx": 0.003274845890700817,
      "rmse_dy": 0.0051176720298826694,
      "rmse_mean": 0.008521524257957935,
      "rotation_flip": 0.004212004132568836,
      "sparse_tokens": 32105.0,
      "step": 9179,
      "turn_loss": 0.07604563236236572,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.4265006504367218,
      "grad_norm": 0.6479652523994446,
      "learning_rate": 1.327938723251908e-06,
      "loss": 0.1382,
      "mae_dtheta": 0.006499315146356821,
      "mae_dx": 0.0013536979677155614,
      "mae_dy": 0.0002742137876339257,
      "pose_mae_dtheta": 0.04717918857932091,
      "pose_mae_dx": 0.010050651617348194,
      "pose_mae_dy": 0.004071781411767006,
      "pose_rmse_dtheta": 0.20735794305801392,
      "pose_rmse_dx": 0.021663468331098557,
      "pose_rmse_dy": 0.012891649268567562,
      "pose_rmse_mean": 0.08063769340515137,
      "rmse_dtheta": 0.02486392669379711,
      "rmse_dx": 0.0037018954753875732,
      "rmse_dy": 0.0006745864520780742,
      "rmse_mean": 0.009746802970767021,
      "rotation_flip": 0.0,
      "sparse_tokens": 32217.0,
      "step": 9180,
      "turn_loss": 0.0377444326877594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4265471102025646,
      "grad_norm": 0.2815280556678772,
      "learning_rate": 1.3270414567123342e-06,
      "loss": 0.0791,
      "mae_dtheta": 0.0060106501914560795,
      "mae_dx": 0.0012687385315075517,
      "mae_dy": 0.0018306056736037135,
      "pose_mae_dtheta": 0.044985879212617874,
      "pose_mae_dx": 0.015782486647367477,
      "pose_mae_dy": 0.020953603088855743,
      "pose_rmse_dtheta": 0.1408219039440155,
      "pose_rmse_dx": 0.04750935733318329,
      "pose_rmse_dy": 0.05701170489192009,
      "pose_rmse_mean": 0.08178099244832993,
      "rmse_dtheta": 0.015116962604224682,
      "rmse_dx": 0.0038398790638893843,
      "rmse_dy": 0.004746472928673029,
      "rmse_mean": 0.007901105098426342,
      "rotation_flip": 0.002461538417264819,
      "sparse_tokens": 32041.0,
      "step": 9181,
      "turn_loss": 0.05218617245554924,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.42659356996840736,
      "grad_norm": 0.5247408747673035,
      "learning_rate": 1.3261444470247237e-06,
      "loss": 0.1127,
      "mae_dtheta": 0.02844267524778843,
      "mae_dx": 0.009397490881383419,
      "mae_dy": 0.008077810518443584,
      "pose_mae_dtheta": 0.19996343553066254,
      "pose_mae_dx": 0.07096855342388153,
      "pose_mae_dy": 0.07476772367954254,
      "pose_rmse_dtheta": 0.3488142788410187,
      "pose_rmse_dx": 0.13744889199733734,
      "pose_rmse_dy": 0.16804622113704681,
      "pose_rmse_mean": 0.21810314059257507,
      "rmse_dtheta": 0.04468768090009689,
      "rmse_dx": 0.018867027014493942,
      "rmse_dy": 0.015720613300800323,
      "rmse_mean": 0.026425106450915337,
      "rotation_flip": 0.014440433122217655,
      "sparse_tokens": 14225.0,
      "step": 9182,
      "turn_loss": 0.3168949782848358,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.42664002973425014,
      "grad_norm": 0.3756573498249054,
      "learning_rate": 1.3252476942518022e-06,
      "loss": 0.0886,
      "mae_dtheta": 0.009133812971413136,
      "mae_dx": 0.0017171864164993167,
      "mae_dy": 0.0017458994407206774,
      "pose_mae_dtheta": 0.05984161049127579,
      "pose_mae_dx": 0.0181330144405365,
      "pose_mae_dy": 0.019120534881949425,
      "pose_rmse_dtheta": 0.14879177510738373,
      "pose_rmse_dx": 0.05842837318778038,
      "pose_rmse_dy": 0.05270659923553467,
      "pose_rmse_mean": 0.08664225041866302,
      "rmse_dtheta": 0.02221778593957424,
      "rmse_dx": 0.005765967536717653,
      "rmse_dy": 0.00461099948734045,
      "rmse_mean": 0.010864917188882828,
      "rotation_flip": 0.00795135647058487,
      "sparse_tokens": 32121.0,
      "step": 9183,
      "turn_loss": 0.07081124931573868,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.4266864895000929,
      "grad_norm": 0.935593843460083,
      "learning_rate": 1.3243511984562824e-06,
      "loss": 0.1656,
      "mae_dtheta": 0.0349406860768795,
      "mae_dx": 0.01432607602328062,
      "mae_dy": 0.004877129103988409,
      "pose_mae_dtheta": 0.3020602762699127,
      "pose_mae_dx": 0.10432861000299454,
      "pose_mae_dy": 0.05024049058556557,
      "pose_rmse_dtheta": 0.566204309463501,
      "pose_rmse_dx": 0.21665148437023163,
      "pose_rmse_dy": 0.13216407597064972,
      "pose_rmse_mean": 0.30500662326812744,
      "rmse_dtheta": 0.055834028869867325,
      "rmse_dx": 0.027702294290065765,
      "rmse_dy": 0.00971164833754301,
      "rmse_mean": 0.03108265809714794,
      "rotation_flip": 0.002020202111452818,
      "sparse_tokens": 9605.0,
      "step": 9184,
      "turn_loss": 0.2959544360637665,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4267329492659357,
      "grad_norm": 0.49821874499320984,
      "learning_rate": 1.3234549597008572e-06,
      "loss": 0.1032,
      "mae_dtheta": 0.005557779222726822,
      "mae_dx": 0.0012289041187614202,
      "mae_dy": 0.0012409079354256392,
      "pose_mae_dtheta": 0.038845375180244446,
      "pose_mae_dx": 0.013760550878942013,
      "pose_mae_dy": 0.014380457811057568,
      "pose_rmse_dtheta": 0.1417655199766159,
      "pose_rmse_dx": 0.04042917862534523,
      "pose_rmse_dy": 0.038767166435718536,
      "pose_rmse_mean": 0.07365395873785019,
      "rmse_dtheta": 0.016726315021514893,
      "rmse_dx": 0.004340192303061485,
      "rmse_dy": 0.003319408977404237,
      "rmse_mean": 0.008128639310598373,
      "rotation_flip": 0.003267973894253373,
      "sparse_tokens": 32057.0,
      "step": 9185,
      "turn_loss": 0.05020436272025108,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37963.0,
      "epoch": 0.42677940903177847,
      "grad_norm": 0.3640856146812439,
      "learning_rate": 1.322558978048199e-06,
      "loss": 0.0885,
      "mae_dtheta": 0.028729258105158806,
      "mae_dx": 0.00960905198007822,
      "mae_dy": 0.0040934644639492035,
      "pose_mae_dtheta": 0.21391575038433075,
      "pose_mae_dx": 0.07069346308708191,
      "pose_mae_dy": 0.039169955998659134,
      "pose_rmse_dtheta": 0.3897189795970917,
      "pose_rmse_dx": 0.17061223089694977,
      "pose_rmse_dy": 0.10168296843767166,
      "pose_rmse_mean": 0.2206714004278183,
      "rmse_dtheta": 0.04520470276474953,
      "rmse_dx": 0.02084062248468399,
      "rmse_dy": 0.008944256231188774,
      "rmse_mean": 0.024996530264616013,
      "rotation_flip": 0.012612612918019295,
      "sparse_tokens": 29747.0,
      "step": 9186,
      "turn_loss": 0.2503339350223541,
      "turns": 117.0,
      "turns_per_sample": 117.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.42682586879762124,
      "grad_norm": 0.37609803676605225,
      "learning_rate": 1.3216632535609664e-06,
      "loss": 0.0783,
      "mae_dtheta": 0.00908364076167345,
      "mae_dx": 0.0013709759805351496,
      "mae_dy": 0.0016939295455813408,
      "pose_mae_dtheta": 0.06499273329973221,
      "pose_mae_dx": 0.013002333231270313,
      "pose_mae_dy": 0.019329234957695007,
      "pose_rmse_dtheta": 0.2248554825782776,
      "pose_rmse_dx": 0.03261799365282059,
      "pose_rmse_dy": 0.0453655980527401,
      "pose_rmse_mean": 0.10094635933637619,
      "rmse_dtheta": 0.024464812129735947,
      "rmse_dx": 0.005382153671234846,
      "rmse_dy": 0.004937964491546154,
      "rmse_mean": 0.011594977229833603,
      "rotation_flip": 0.0064239827916026115,
      "sparse_tokens": 32089.0,
      "step": 9187,
      "turn_loss": 0.06176086515188217,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.426872328563464,
      "grad_norm": 0.6205754280090332,
      "learning_rate": 1.3207677863017955e-06,
      "loss": 0.1509,
      "mae_dtheta": 0.02785053849220276,
      "mae_dx": 0.01860249787569046,
      "mae_dy": 0.00430054496973753,
      "pose_mae_dtheta": 0.21922311186790466,
      "pose_mae_dx": 0.15898948907852173,
      "pose_mae_dy": 0.0583454854786396,
      "pose_rmse_dtheta": 0.36761993169784546,
      "pose_rmse_dx": 0.31801876425743103,
      "pose_rmse_dy": 0.1409808099269867,
      "pose_rmse_mean": 0.2755398452281952,
      "rmse_dtheta": 0.04306967929005623,
      "rmse_dx": 0.03293105587363243,
      "rmse_dy": 0.00904636736959219,
      "rmse_mean": 0.02834903448820114,
      "rotation_flip": 0.015317286364734173,
      "sparse_tokens": 8778.0,
      "step": 9188,
      "turn_loss": 0.2531154155731201,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4269187883293068,
      "grad_norm": 0.44159409403800964,
      "learning_rate": 1.3198725763333093e-06,
      "loss": 0.1006,
      "mae_dtheta": 0.0078134099021554,
      "mae_dx": 0.0016888610552996397,
      "mae_dy": 0.002205505268648267,
      "pose_mae_dtheta": 0.05513649806380272,
      "pose_mae_dx": 0.0186627060174942,
      "pose_mae_dy": 0.02204585261642933,
      "pose_rmse_dtheta": 0.12199518829584122,
      "pose_rmse_dx": 0.050896987318992615,
      "pose_rmse_dy": 0.05320160090923309,
      "pose_rmse_mean": 0.0753645971417427,
      "rmse_dtheta": 0.0175270214676857,
      "rmse_dx": 0.005253220908343792,
      "rmse_dy": 0.005680902861058712,
      "rmse_mean": 0.009487049654126167,
      "rotation_flip": 0.002261590678244829,
      "sparse_tokens": 32153.0,
      "step": 9189,
      "turn_loss": 0.07127305120229721,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4269652480951496,
      "grad_norm": 0.4045124053955078,
      "learning_rate": 1.3189776237181074e-06,
      "loss": 0.0952,
      "mae_dtheta": 0.008051235228776932,
      "mae_dx": 0.0017811437137424946,
      "mae_dy": 0.0020596222020685673,
      "pose_mae_dtheta": 0.056985363364219666,
      "pose_mae_dx": 0.018270522356033325,
      "pose_mae_dy": 0.023661959916353226,
      "pose_rmse_dtheta": 0.14912591874599457,
      "pose_rmse_dx": 0.05189065262675285,
      "pose_rmse_dy": 0.060287702828645706,
      "pose_rmse_mean": 0.08710142970085144,
      "rmse_dtheta": 0.019804317504167557,
      "rmse_dx": 0.006127092055976391,
      "rmse_dy": 0.0054474701173603535,
      "rmse_mean": 0.010459627024829388,
      "rotation_flip": 0.005160778295248747,
      "sparse_tokens": 32121.0,
      "step": 9190,
      "turn_loss": 0.07407771050930023,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4270117078609924,
      "grad_norm": 0.4255203604698181,
      "learning_rate": 1.3180829285187764e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.01337011344730854,
      "mae_dx": 0.0034915325231850147,
      "mae_dy": 0.005260153207927942,
      "pose_mae_dtheta": 0.09337073564529419,
      "pose_mae_dx": 0.04403628408908844,
      "pose_mae_dy": 0.04875652492046356,
      "pose_rmse_dtheta": 0.22192281484603882,
      "pose_rmse_dx": 0.11190690100193024,
      "pose_rmse_dy": 0.1085507944226265,
      "pose_rmse_mean": 0.14746016263961792,
      "rmse_dtheta": 0.027503076940774918,
      "rmse_dx": 0.008710567839443684,
      "rmse_dy": 0.010782294906675816,
      "rmse_mean": 0.015665313228964806,
      "rotation_flip": 0.00818866677582264,
      "sparse_tokens": 32121.0,
      "step": 9191,
      "turn_loss": 0.14178171753883362,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4270581676268352,
      "grad_norm": 0.49628087878227234,
      "learning_rate": 1.3171884907978839e-06,
      "loss": 0.055,
      "mae_dtheta": 0.005926669109612703,
      "mae_dx": 0.0008629129151813686,
      "mae_dy": 0.0013976864283904433,
      "pose_mae_dtheta": 0.036727190017700195,
      "pose_mae_dx": 0.0096463393419981,
      "pose_mae_dy": 0.012907510623335838,
      "pose_rmse_dtheta": 0.11525516957044601,
      "pose_rmse_dx": 0.025451207533478737,
      "pose_rmse_dy": 0.03549616411328316,
      "pose_rmse_mean": 0.05873417854309082,
      "rmse_dtheta": 0.016268998384475708,
      "rmse_dx": 0.0025315212551504374,
      "rmse_dy": 0.0039215087890625,
      "rmse_mean": 0.007574009709060192,
      "rotation_flip": 0.0020942408591508865,
      "sparse_tokens": 32089.0,
      "step": 9192,
      "turn_loss": 0.04097149893641472,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.42710462739267796,
      "grad_norm": 0.4932040572166443,
      "learning_rate": 1.3162943106179748e-06,
      "loss": 0.102,
      "mae_dtheta": 0.03208888694643974,
      "mae_dx": 0.00981338880956173,
      "mae_dy": 0.005458959843963385,
      "pose_mae_dtheta": 0.2516378164291382,
      "pose_mae_dx": 0.09918126463890076,
      "pose_mae_dy": 0.08630987256765366,
      "pose_rmse_dtheta": 0.4472746253013611,
      "pose_rmse_dx": 0.21007414162158966,
      "pose_rmse_dy": 0.15388169884681702,
      "pose_rmse_mean": 0.2704101502895355,
      "rmse_dtheta": 0.04885588213801384,
      "rmse_dx": 0.021368496119976044,
      "rmse_dy": 0.008852287195622921,
      "rmse_mean": 0.026358887553215027,
      "rotation_flip": 0.007017544005066156,
      "sparse_tokens": 9941.0,
      "step": 9193,
      "turn_loss": 0.23281732201576233,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.42715108715852074,
      "grad_norm": 0.40880900621414185,
      "learning_rate": 1.3154003880415839e-06,
      "loss": 0.1266,
      "mae_dtheta": 0.011359572410583496,
      "mae_dx": 0.0015167690580710769,
      "mae_dy": 0.002557084197178483,
      "pose_mae_dtheta": 0.0735955461859703,
      "pose_mae_dx": 0.019188307225704193,
      "pose_mae_dy": 0.0312446691095829,
      "pose_rmse_dtheta": 0.15182170271873474,
      "pose_rmse_dx": 0.044913582503795624,
      "pose_rmse_dy": 0.0790926143527031,
      "pose_rmse_mean": 0.09194263815879822,
      "rmse_dtheta": 0.02139248512685299,
      "rmse_dx": 0.004572965670377016,
      "rmse_dy": 0.0052963257767260075,
      "rmse_mean": 0.010420592501759529,
      "rotation_flip": 0.006958942394703627,
      "sparse_tokens": 32105.0,
      "step": 9194,
      "turn_loss": 0.09703110158443451,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.4271975469243635,
      "grad_norm": 0.6971649527549744,
      "learning_rate": 1.3145067231312198e-06,
      "loss": 0.1327,
      "mae_dtheta": 0.03073616325855255,
      "mae_dx": 0.012704683467745781,
      "mae_dy": 0.013649899512529373,
      "pose_mae_dtheta": 0.19900289177894592,
      "pose_mae_dx": 0.07990250736474991,
      "pose_mae_dy": 0.14493587613105774,
      "pose_rmse_dtheta": 0.32313811779022217,
      "pose_rmse_dx": 0.13891588151454926,
      "pose_rmse_dy": 0.235517218708992,
      "pose_rmse_mean": 0.23252373933792114,
      "rmse_dtheta": 0.04282297566533089,
      "rmse_dx": 0.022504663094878197,
      "rmse_dy": 0.020375654101371765,
      "rmse_mean": 0.028567764908075333,
      "rotation_flip": 0.007299270015209913,
      "sparse_tokens": 2902.0,
      "step": 9195,
      "turn_loss": 0.46338844299316406,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4272440066902063,
      "grad_norm": 0.4213598370552063,
      "learning_rate": 1.3136133159493803e-06,
      "loss": 0.0826,
      "mae_dtheta": 0.007661736570298672,
      "mae_dx": 0.0011373222805559635,
      "mae_dy": 0.00169380905572325,
      "pose_mae_dtheta": 0.05431906878948212,
      "pose_mae_dx": 0.0145238833501935,
      "pose_mae_dy": 0.023314977064728737,
      "pose_rmse_dtheta": 0.1477058082818985,
      "pose_rmse_dx": 0.04679127037525177,
      "pose_rmse_dy": 0.05599531903862953,
      "pose_rmse_mean": 0.08349746465682983,
      "rmse_dtheta": 0.017691105604171753,
      "rmse_dx": 0.003759630722925067,
      "rmse_dy": 0.003918005619198084,
      "rmse_mean": 0.008456246927380562,
      "rotation_flip": 0.0038395903538912535,
      "sparse_tokens": 32073.0,
      "step": 9196,
      "turn_loss": 0.06173339858651161,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.42729046645604907,
      "grad_norm": 0.5845608115196228,
      "learning_rate": 1.3127201665585386e-06,
      "loss": 0.0852,
      "mae_dtheta": 0.007348462473601103,
      "mae_dx": 0.0009619505144655704,
      "mae_dy": 0.0016798689030110836,
      "pose_mae_dtheta": 0.05164002627134323,
      "pose_mae_dx": 0.01698664017021656,
      "pose_mae_dy": 0.024763599038124084,
      "pose_rmse_dtheta": 0.10160992294549942,
      "pose_rmse_dx": 0.045125752687454224,
      "pose_rmse_dy": 0.060691624879837036,
      "pose_rmse_mean": 0.0691424310207367,
      "rmse_dtheta": 0.015122739598155022,
      "rmse_dx": 0.0027545185294002295,
      "rmse_dy": 0.0034333565272390842,
      "rmse_mean": 0.007103538140654564,
      "rotation_flip": 0.0015841583954170346,
      "sparse_tokens": 32073.0,
      "step": 9197,
      "turn_loss": 0.056886930018663406,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.42733692622189184,
      "grad_norm": 0.6356522440910339,
      "learning_rate": 1.3118272750211547e-06,
      "loss": 0.1018,
      "mae_dtheta": 0.010648395866155624,
      "mae_dx": 0.00592613173648715,
      "mae_dy": 0.0030726753175258636,
      "pose_mae_dtheta": 0.07573772966861725,
      "pose_mae_dx": 0.04541992023587227,
      "pose_mae_dy": 0.029272686690092087,
      "pose_rmse_dtheta": 0.1680818796157837,
      "pose_rmse_dx": 0.12965650856494904,
      "pose_rmse_dy": 0.09228365123271942,
      "pose_rmse_mean": 0.13000735640525818,
      "rmse_dtheta": 0.022083260118961334,
      "rmse_dx": 0.0178245659917593,
      "rmse_dy": 0.009196847677230835,
      "rmse_mean": 0.01636822521686554,
      "rotation_flip": 0.009523809887468815,
      "sparse_tokens": 13097.0,
      "step": 9198,
      "turn_loss": 0.10328367352485657,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4273833859877346,
      "grad_norm": 0.43974828720092773,
      "learning_rate": 1.310934641399671e-06,
      "loss": 0.1107,
      "mae_dtheta": 0.011653955094516277,
      "mae_dx": 0.0020689740777015686,
      "mae_dy": 0.003441566601395607,
      "pose_mae_dtheta": 0.07605135440826416,
      "pose_mae_dx": 0.025654399767518044,
      "pose_mae_dy": 0.0341496467590332,
      "pose_rmse_dtheta": 0.1495797485113144,
      "pose_rmse_dx": 0.05954854562878609,
      "pose_rmse_dy": 0.07070860266685486,
      "pose_rmse_mean": 0.09327896684408188,
      "rmse_dtheta": 0.02160823717713356,
      "rmse_dx": 0.005229694303125143,
      "rmse_dy": 0.006971872877329588,
      "rmse_mean": 0.011269934475421906,
      "rotation_flip": 0.00820966251194477,
      "sparse_tokens": 32121.0,
      "step": 9199,
      "turn_loss": 0.10212772339582443,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.4274298457535774,
      "grad_norm": 0.5129926204681396,
      "learning_rate": 1.310042265756506e-06,
      "loss": 0.1211,
      "mae_dtheta": 0.034454815089702606,
      "mae_dx": 0.011008534580469131,
      "mae_dy": 0.007084870710968971,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5129928588867188,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.61663818359375,
      "model/head/act_norm_mean": 110.00638786764706,
      "model/head/act_norm_min": 66.38607788085938,
      "model/head/act_over_embed": 75.59741963867656,
      "model/head/grad_frac": 0.09190716594457626,
      "model/head/grad_norm": 0.0471477210521698,
      "model/head/grad_zero_frac": 0.00021035117970313877,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7045036764705882,
      "model/head/update_ratio": 0.0008028147858567536,
      "model/head/weight_delta": 9.883034706115723,
      "model/head/weight_delta_rel": 0.17337770760059357,
      "model/head/weight_norm": 58.72801971435547,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4226023852825165,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4226023852825165,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226023852825165,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904163156320115,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08045083284378052,
      "model/modality_embedder.encoders.pose/grad_norm": 0.041270703077316284,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013326478656381369,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1363883018493652,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10247558355331421,
      "model/modality_embedder.encoders.pose/weight_norm": 30.968948364257812,
      "model/modality_embedder/grad_frac": 0.08045083284378052,
      "model/modality_embedder/grad_norm": 0.041270703077316284,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0013326478656381369,
      "model/modality_embedder/weight_delta": 3.1363883018493652,
      "model/modality_embedder/weight_delta_rel": 0.10247558355331421,
      "model/modality_embedder/weight_norm": 30.968948364257812,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.83394622802734,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.655279820261438,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.144847869873047,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.256129756702563,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05861487239599228,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.030069010332226753,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010758363641798496,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6888585090637207,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09798362851142883,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.94942855834961,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.09918975830078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.413149218020543,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.460731506347656,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.77694470212771,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06644272804260254,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03408464416861534,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011456375941634178,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4088525772094727,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11808531731367111,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.751680374145508,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.7091293334961,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.96362336601307,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.478095054626465,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.84244505239585,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06388605386018753,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03277308866381645,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010667676106095314,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6901509761810303,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12390836328268051,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.72186279296875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.39790344238281,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.80199871615313,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.184097290039062,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.10579380415329,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06477505713701248,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03322914242744446,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011098823742941022,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1679608821868896,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10826586931943893,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9393367767334,
      "model/normalizer/grad_frac": 0.25321367383003235,
      "model/normalizer/grad_norm": 0.12989680469036102,
      "model/normalizer/grad_zero_frac": 0.00023398420307785273,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016518644988536835,
      "model/normalizer/weight_delta": 6.6711530685424805,
      "model/normalizer/weight_delta_rel": 0.08592058718204498,
      "model/normalizer/weight_norm": 78.636474609375,
      "pose_mae_dtheta": 0.2974258065223694,
      "pose_mae_dx": 0.08823157101869583,
      "pose_mae_dy": 0.0853770300745964,
      "pose_rmse_dtheta": 0.5179247260093689,
      "pose_rmse_dx": 0.20046740770339966,
      "pose_rmse_dy": 0.1971893608570099,
      "pose_rmse_mean": 0.30519384145736694,
      "rmse_dtheta": 0.05249791964888573,
      "rmse_dx": 0.022599240764975548,
      "rmse_dy": 0.015853004530072212,
      "rmse_mean": 0.03031672164797783,
      "rotation_flip": 0.002654867246747017,
      "sparse_tokens": 21025.0,
      "step": 9200,
      "turn_loss": 0.28007107973098755,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "epoch": 0.4274298457535774,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30281367897987366,
      "eval_objectnav_nopose_mae_dtheta": 0.03883545473217964,
      "eval_objectnav_nopose_mae_dx": 0.01291508600115776,
      "eval_objectnav_nopose_mae_dy": 0.004965809173882008,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3105894923210144,
      "eval_objectnav_nopose_pose_mae_dx": 0.10427170246839523,
      "eval_objectnav_nopose_pose_mae_dy": 0.05530022829771042,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5297145843505859,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2306097447872162,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1315898597240448,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29730474948883057,
      "eval_objectnav_nopose_rmse_dtheta": 0.05659322068095207,
      "eval_objectnav_nopose_rmse_dx": 0.025396810844540596,
      "eval_objectnav_nopose_rmse_dy": 0.010156217962503433,
      "eval_objectnav_nopose_rmse_mean": 0.030715417116880417,
      "eval_objectnav_nopose_rotation_flip": 0.014608154073357582,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30281367897987366,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 9200
    },
    {
      "epoch": 0.4274298457535774,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2735612988471985,
      "eval_objectnav_pose_mae_dtheta": 0.03470867872238159,
      "eval_objectnav_pose_mae_dx": 0.010790618136525154,
      "eval_objectnav_pose_mae_dy": 0.004610294476151466,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26235753297805786,
      "eval_objectnav_pose_pose_mae_dx": 0.08440521359443665,
      "eval_objectnav_pose_pose_mae_dy": 0.04720927029848099,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4663422703742981,
      "eval_objectnav_pose_pose_rmse_dx": 0.19661930203437805,
      "eval_objectnav_pose_pose_rmse_dy": 0.11606866866350174,
      "eval_objectnav_pose_pose_rmse_mean": 0.2596767544746399,
      "eval_objectnav_pose_rmse_dtheta": 0.05254412442445755,
      "eval_objectnav_pose_rmse_dx": 0.0226402897387743,
      "eval_objectnav_pose_rmse_dy": 0.009678101167082787,
      "eval_objectnav_pose_rmse_mean": 0.028287505730986595,
      "eval_objectnav_pose_rotation_flip": 0.013903658837080002,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2735612988471985,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 9200
    },
    {
      "epoch": 0.4274298457535774,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08822795748710632,
      "eval_pointnav_mae_dtheta": 0.010125568136572838,
      "eval_pointnav_mae_dx": 0.002246386604383588,
      "eval_pointnav_mae_dy": 0.002346326131373644,
      "eval_pointnav_pose_mae_dtheta": 0.06854241341352463,
      "eval_pointnav_pose_mae_dx": 0.025107651948928833,
      "eval_pointnav_pose_mae_dy": 0.024486830458045006,
      "eval_pointnav_pose_rmse_dtheta": 0.19879150390625,
      "eval_pointnav_pose_rmse_dx": 0.08058837801218033,
      "eval_pointnav_pose_rmse_dy": 0.07214786857366562,
      "eval_pointnav_pose_rmse_mean": 0.11717592179775238,
      "eval_pointnav_rmse_dtheta": 0.02547205239534378,
      "eval_pointnav_rmse_dx": 0.007432478945702314,
      "eval_pointnav_rmse_dy": 0.006525399629026651,
      "eval_pointnav_rmse_mean": 0.013143311254680157,
      "eval_pointnav_rotation_flip": 0.005116535350680351,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08822795748710632,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 9200
    },
    {
      "epoch": 0.4274298457535774,
      "eval_loss": 0.22153431177139282,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30281367897987366,
      "eval_objectnav_nopose_mae_dtheta": 0.03883545473217964,
      "eval_objectnav_nopose_mae_dx": 0.01291508600115776,
      "eval_objectnav_nopose_mae_dy": 0.004965809173882008,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3105894923210144,
      "eval_objectnav_nopose_pose_mae_dx": 0.10427170246839523,
      "eval_objectnav_nopose_pose_mae_dy": 0.05530022829771042,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5297145843505859,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2306097447872162,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1315898597240448,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29730474948883057,
      "eval_objectnav_nopose_rmse_dtheta": 0.05659322068095207,
      "eval_objectnav_nopose_rmse_dx": 0.025396810844540596,
      "eval_objectnav_nopose_rmse_dy": 0.010156217962503433,
      "eval_objectnav_nopose_rmse_mean": 0.030715417116880417,
      "eval_objectnav_nopose_rotation_flip": 0.014608154073357582,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30281367897987366,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2735612988471985,
      "eval_objectnav_pose_mae_dtheta": 0.03470867872238159,
      "eval_objectnav_pose_mae_dx": 0.010790618136525154,
      "eval_objectnav_pose_mae_dy": 0.004610294476151466,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26235753297805786,
      "eval_objectnav_pose_pose_mae_dx": 0.08440521359443665,
      "eval_objectnav_pose_pose_mae_dy": 0.04720927029848099,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4663422703742981,
      "eval_objectnav_pose_pose_rmse_dx": 0.19661930203437805,
      "eval_objectnav_pose_pose_rmse_dy": 0.11606866866350174,
      "eval_objectnav_pose_pose_rmse_mean": 0.2596767544746399,
      "eval_objectnav_pose_rmse_dtheta": 0.05254412442445755,
      "eval_objectnav_pose_rmse_dx": 0.0226402897387743,
      "eval_objectnav_pose_rmse_dy": 0.009678101167082787,
      "eval_objectnav_pose_rmse_mean": 0.028287505730986595,
      "eval_objectnav_pose_rotation_flip": 0.013903658837080002,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2735612988471985,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08822795748710632,
      "eval_pointnav_mae_dtheta": 0.010125568136572838,
      "eval_pointnav_mae_dx": 0.002246386604383588,
      "eval_pointnav_mae_dy": 0.002346326131373644,
      "eval_pointnav_pose_mae_dtheta": 0.06854241341352463,
      "eval_pointnav_pose_mae_dx": 0.025107651948928833,
      "eval_pointnav_pose_mae_dy": 0.024486830458045006,
      "eval_pointnav_pose_rmse_dtheta": 0.19879150390625,
      "eval_pointnav_pose_rmse_dx": 0.08058837801218033,
      "eval_pointnav_pose_rmse_dy": 0.07214786857366562,
      "eval_pointnav_pose_rmse_mean": 0.11717592179775238,
      "eval_pointnav_rmse_dtheta": 0.02547205239534378,
      "eval_pointnav_rmse_dx": 0.007432478945702314,
      "eval_pointnav_rmse_dy": 0.006525399629026651,
      "eval_pointnav_rmse_mean": 0.013143311254680157,
      "eval_pointnav_rotation_flip": 0.005116535350680351,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08822795748710632,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 9200
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.4274763055194202,
      "grad_norm": 0.4153328537940979,
      "learning_rate": 1.3091501481540676e-06,
      "loss": 0.1055,
      "mae_dtheta": 0.036079615354537964,
      "mae_dx": 0.01622132398188114,
      "mae_dy": 0.004755991976708174,
      "pose_mae_dtheta": 0.2869832217693329,
      "pose_mae_dx": 0.11970102041959763,
      "pose_mae_dy": 0.058235593140125275,
      "pose_rmse_dtheta": 0.4150610864162445,
      "pose_rmse_dx": 0.23446393013000488,
      "pose_rmse_dy": 0.12367850542068481,
      "pose_rmse_mean": 0.2577345371246338,
      "rmse_dtheta": 0.0481005497276783,
      "rmse_dx": 0.02760826237499714,
      "rmse_dy": 0.008791943080723286,
      "rmse_mean": 0.028166919946670532,
      "rotation_flip": 0.012558870017528534,
      "sparse_tokens": 9521.0,
      "step": 9201,
      "turn_loss": 0.40091201663017273,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.42752276528526295,
      "grad_norm": 0.2796083390712738,
      "learning_rate": 1.3082582886547397e-06,
      "loss": 0.0583,
      "mae_dtheta": 0.006468914449214935,
      "mae_dx": 0.0012171047274023294,
      "mae_dy": 0.0016321154544129968,
      "pose_mae_dtheta": 0.04196060821413994,
      "pose_mae_dx": 0.01666412688791752,
      "pose_mae_dy": 0.019503368064761162,
      "pose_rmse_dtheta": 0.11096043139696121,
      "pose_rmse_dx": 0.05316098779439926,
      "pose_rmse_dy": 0.05793584883213043,
      "pose_rmse_mean": 0.07401908934116364,
      "rmse_dtheta": 0.016304602846503258,
      "rmse_dx": 0.0037262931000441313,
      "rmse_dy": 0.004647820256650448,
      "rmse_mean": 0.008226238191127777,
      "rotation_flip": 0.0018957345746457577,
      "sparse_tokens": 32105.0,
      "step": 9202,
      "turn_loss": 0.05664784088730812,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.42756922505110573,
      "grad_norm": 0.4494434595108032,
      "learning_rate": 1.3073666873208901e-06,
      "loss": 0.0952,
      "mae_dtheta": 0.03473583608865738,
      "mae_dx": 0.011485414579510689,
      "mae_dy": 0.005893244873732328,
      "pose_mae_dtheta": 0.29721730947494507,
      "pose_mae_dx": 0.09862834960222244,
      "pose_mae_dy": 0.04664360731840134,
      "pose_rmse_dtheta": 0.5437251329421997,
      "pose_rmse_dx": 0.2236669659614563,
      "pose_rmse_dy": 0.11266510933637619,
      "pose_rmse_mean": 0.2933524250984192,
      "rmse_dtheta": 0.05487063154578209,
      "rmse_dx": 0.022779593244194984,
      "rmse_dy": 0.014754037372767925,
      "rmse_mean": 0.030801421031355858,
      "rotation_flip": 0.014644351787865162,
      "sparse_tokens": 7961.0,
      "step": 9203,
      "turn_loss": 0.2661772072315216,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.4276156848169485,
      "grad_norm": 0.5881726145744324,
      "learning_rate": 1.3064753442148713e-06,
      "loss": 0.2174,
      "mae_dtheta": 0.03842160478234291,
      "mae_dx": 0.014403387904167175,
      "mae_dy": 0.0073570264503359795,
      "pose_mae_dtheta": 0.316269189119339,
      "pose_mae_dx": 0.10820870846509933,
      "pose_mae_dy": 0.08390052616596222,
      "pose_rmse_dtheta": 0.5197005271911621,
      "pose_rmse_dx": 0.22580960392951965,
      "pose_rmse_dy": 0.20222772657871246,
      "pose_rmse_mean": 0.3159126043319702,
      "rmse_dtheta": 0.05606423318386078,
      "rmse_dx": 0.02648334391415119,
      "rmse_dy": 0.01658729650080204,
      "rmse_mean": 0.033044956624507904,
      "rotation_flip": 0.013729977421462536,
      "sparse_tokens": 21345.0,
      "step": 9204,
      "turn_loss": 0.32259634137153625,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 28139.0,
      "epoch": 0.4276621445827913,
      "grad_norm": 0.5344918966293335,
      "learning_rate": 1.305584259399013e-06,
      "loss": 0.1644,
      "mae_dtheta": 0.038733821362257004,
      "mae_dx": 0.009503972716629505,
      "mae_dy": 0.005604312755167484,
      "pose_mae_dtheta": 0.28457051515579224,
      "pose_mae_dx": 0.07735147327184677,
      "pose_mae_dy": 0.07317985594272614,
      "pose_rmse_dtheta": 0.4847939908504486,
      "pose_rmse_dx": 0.1703006774187088,
      "pose_rmse_dy": 0.16714106500148773,
      "pose_rmse_mean": 0.2740786075592041,
      "rmse_dtheta": 0.056885235011577606,
      "rmse_dx": 0.020518798381090164,
      "rmse_dy": 0.010743687860667706,
      "rmse_mean": 0.029382575303316116,
      "rotation_flip": 0.0153733529150486,
      "sparse_tokens": 21991.0,
      "step": 9205,
      "turn_loss": 0.3026391267776489,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.42770860434863406,
      "grad_norm": 1.2149978876113892,
      "learning_rate": 1.3046934329356314e-06,
      "loss": 0.2189,
      "mae_dtheta": 0.02587295137345791,
      "mae_dx": 0.00903839711099863,
      "mae_dy": 0.00285066245123744,
      "pose_mae_dtheta": 0.2074650228023529,
      "pose_mae_dx": 0.06572408974170685,
      "pose_mae_dy": 0.02280947007238865,
      "pose_rmse_dtheta": 0.37054869532585144,
      "pose_rmse_dx": 0.13829821348190308,
      "pose_rmse_dy": 0.04863523691892624,
      "pose_rmse_mean": 0.185827374458313,
      "rmse_dtheta": 0.04304598644375801,
      "rmse_dx": 0.018244687467813492,
      "rmse_dy": 0.005841113161295652,
      "rmse_mean": 0.022377263754606247,
      "rotation_flip": 0.009208102710545063,
      "sparse_tokens": 10567.0,
      "step": 9206,
      "turn_loss": 0.20589123666286469,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.4277550641144769,
      "grad_norm": 0.44464680552482605,
      "learning_rate": 1.3038028648870204e-06,
      "loss": 0.1224,
      "mae_dtheta": 0.042954470962285995,
      "mae_dx": 0.02747279591858387,
      "mae_dy": 0.007767423987388611,
      "pose_mae_dtheta": 0.36066606640815735,
      "pose_mae_dx": 0.2393079698085785,
      "pose_mae_dy": 0.11623113602399826,
      "pose_rmse_dtheta": 0.5669066905975342,
      "pose_rmse_dx": 0.3920401334762573,
      "pose_rmse_dy": 0.24355489015579224,
      "pose_rmse_mean": 0.40083393454551697,
      "rmse_dtheta": 0.059236373752355576,
      "rmse_dx": 0.04010898247361183,
      "rmse_dy": 0.01421276479959488,
      "rmse_mean": 0.037852708250284195,
      "rotation_flip": 0.020457280799746513,
      "sparse_tokens": 13731.0,
      "step": 9207,
      "turn_loss": 0.44308874011039734,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.42780152388031967,
      "grad_norm": 0.3999576270580292,
      "learning_rate": 1.3029125553154604e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.009307144209742546,
      "mae_dx": 0.0018031253712251782,
      "mae_dy": 0.001981229055672884,
      "pose_mae_dtheta": 0.06120267137885094,
      "pose_mae_dx": 0.017753558233380318,
      "pose_mae_dy": 0.0205994863063097,
      "pose_rmse_dtheta": 0.1816548854112625,
      "pose_rmse_dx": 0.04811533913016319,
      "pose_rmse_dy": 0.047909632325172424,
      "pose_rmse_mean": 0.09255995601415634,
      "rmse_dtheta": 0.023114923387765884,
      "rmse_dx": 0.006152105517685413,
      "rmse_dy": 0.005445241928100586,
      "rmse_mean": 0.011570757254958153,
      "rotation_flip": 0.006805292796343565,
      "sparse_tokens": 32105.0,
      "step": 9208,
      "turn_loss": 0.07856307178735733,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.42784798364616244,
      "grad_norm": 0.46602359414100647,
      "learning_rate": 1.3020225042832079e-06,
      "loss": 0.0761,
      "mae_dtheta": 0.012814347632229328,
      "mae_dx": 0.0028833281248807907,
      "mae_dy": 0.003922124858945608,
      "pose_mae_dtheta": 0.08662575483322144,
      "pose_mae_dx": 0.03747231513261795,
      "pose_mae_dy": 0.04001139476895332,
      "pose_rmse_dtheta": 0.21358554065227509,
      "pose_rmse_dx": 0.13538402318954468,
      "pose_rmse_dy": 0.12460757046937943,
      "pose_rmse_mean": 0.15785905718803406,
      "rmse_dtheta": 0.026630138978362083,
      "rmse_dx": 0.009933148510754108,
      "rmse_dy": 0.009721929207444191,
      "rmse_mean": 0.015428407117724419,
      "rotation_flip": 0.010741859674453735,
      "sparse_tokens": 32137.0,
      "step": 9209,
      "turn_loss": 0.12323171645402908,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.4278944434120052,
      "grad_norm": 0.3783731460571289,
      "learning_rate": 1.301132711852507e-06,
      "loss": 0.087,
      "mae_dtheta": 0.043315589427948,
      "mae_dx": 0.014836309477686882,
      "mae_dy": 0.0062056477181613445,
      "pose_mae_dtheta": 0.36089888215065,
      "pose_mae_dx": 0.12539033591747284,
      "pose_mae_dy": 0.05580494925379753,
      "pose_rmse_dtheta": 0.5959645509719849,
      "pose_rmse_dx": 0.2517552077770233,
      "pose_rmse_dy": 0.12544262409210205,
      "pose_rmse_mean": 0.32438749074935913,
      "rmse_dtheta": 0.06224017217755318,
      "rmse_dx": 0.02849034033715725,
      "rmse_dy": 0.012253403663635254,
      "rmse_mean": 0.034327972680330276,
      "rotation_flip": 0.030131826177239418,
      "sparse_tokens": 8611.0,
      "step": 9210,
      "turn_loss": 0.2958693504333496,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.427940903177848,
      "grad_norm": 0.5520433187484741,
      "learning_rate": 1.3002431780855817e-06,
      "loss": 0.1776,
      "mae_dtheta": 0.01247448567301035,
      "mae_dx": 0.0018631756538525224,
      "mae_dy": 0.003258753102272749,
      "pose_mae_dtheta": 0.07536952942609787,
      "pose_mae_dx": 0.02343798615038395,
      "pose_mae_dy": 0.02949678711593151,
      "pose_rmse_dtheta": 0.1779494285583496,
      "pose_rmse_dx": 0.0585860051214695,
      "pose_rmse_dy": 0.0594814158976078,
      "pose_rmse_mean": 0.0986722856760025,
      "rmse_dtheta": 0.023819781839847565,
      "rmse_dx": 0.0052308738231658936,
      "rmse_dy": 0.007255971897393465,
      "rmse_mean": 0.012102209031581879,
      "rotation_flip": 0.006482982076704502,
      "sparse_tokens": 32105.0,
      "step": 9211,
      "turn_loss": 0.10135769098997116,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.4279873629436908,
      "grad_norm": 0.5412863492965698,
      "learning_rate": 1.2993539030446356e-06,
      "loss": 0.1026,
      "mae_dtheta": 0.02739858068525791,
      "mae_dx": 0.011139894835650921,
      "mae_dy": 0.005957034882158041,
      "pose_mae_dtheta": 0.23572860658168793,
      "pose_mae_dx": 0.0813409760594368,
      "pose_mae_dy": 0.09489639848470688,
      "pose_rmse_dtheta": 0.3826634883880615,
      "pose_rmse_dx": 0.20209866762161255,
      "pose_rmse_dy": 0.20949368178844452,
      "pose_rmse_mean": 0.26475197076797485,
      "rmse_dtheta": 0.04081236571073532,
      "rmse_dx": 0.02504148706793785,
      "rmse_dy": 0.01032994408160448,
      "rmse_mean": 0.02539459988474846,
      "rotation_flip": 0.013020833022892475,
      "sparse_tokens": 6336.0,
      "step": 9212,
      "turn_loss": 0.1789967566728592,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.42803382270953355,
      "grad_norm": 0.5900056958198547,
      "learning_rate": 1.2984648867918587e-06,
      "loss": 0.2069,
      "mae_dtheta": 0.01273979153484106,
      "mae_dx": 0.0013292504008859396,
      "mae_dy": 0.002189232502132654,
      "pose_mae_dtheta": 0.07851677387952805,
      "pose_mae_dx": 0.017126580700278282,
      "pose_mae_dy": 0.02493632771074772,
      "pose_rmse_dtheta": 0.22530531883239746,
      "pose_rmse_dx": 0.04096866026520729,
      "pose_rmse_dy": 0.05707348883152008,
      "pose_rmse_mean": 0.10778248310089111,
      "rmse_dtheta": 0.02747291512787342,
      "rmse_dx": 0.004155187401920557,
      "rmse_dy": 0.004795585758984089,
      "rmse_mean": 0.012141229584813118,
      "rotation_flip": 0.006021962501108646,
      "sparse_tokens": 32105.0,
      "step": 9213,
      "turn_loss": 0.09028437733650208,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.42808028247537633,
      "grad_norm": 0.4899364709854126,
      "learning_rate": 1.2975761293894179e-06,
      "loss": 0.0971,
      "mae_dtheta": 0.012320972047746181,
      "mae_dx": 0.001515907933935523,
      "mae_dy": 0.0018789500463753939,
      "pose_mae_dtheta": 0.08290665596723557,
      "pose_mae_dx": 0.02087477035820484,
      "pose_mae_dy": 0.02528906613588333,
      "pose_rmse_dtheta": 0.2200395166873932,
      "pose_rmse_dx": 0.05547960102558136,
      "pose_rmse_dy": 0.060215141624212265,
      "pose_rmse_mean": 0.11191143095493317,
      "rmse_dtheta": 0.026950526982545853,
      "rmse_dx": 0.004917515441775322,
      "rmse_dy": 0.004025371745228767,
      "rmse_mean": 0.011964470148086548,
      "rotation_flip": 0.003811944043263793,
      "sparse_tokens": 32073.0,
      "step": 9214,
      "turn_loss": 0.08496281504631042,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.4281267422412191,
      "grad_norm": 0.8262403607368469,
      "learning_rate": 1.2966876308994669e-06,
      "loss": 0.171,
      "mae_dtheta": 0.03746746852993965,
      "mae_dx": 0.012624784372746944,
      "mae_dy": 0.006871390156447887,
      "pose_mae_dtheta": 0.29097431898117065,
      "pose_mae_dx": 0.10791068524122238,
      "pose_mae_dy": 0.08094941079616547,
      "pose_rmse_dtheta": 0.4908648729324341,
      "pose_rmse_dx": 0.22559858858585358,
      "pose_rmse_dy": 0.17062076926231384,
      "pose_rmse_mean": 0.2956947684288025,
      "rmse_dtheta": 0.055557265877723694,
      "rmse_dx": 0.025116421282291412,
      "rmse_dy": 0.012678570114076138,
      "rmse_mean": 0.03111742064356804,
      "rotation_flip": 0.018145160749554634,
      "sparse_tokens": 16989.0,
      "step": 9215,
      "turn_loss": 0.31108883023262024,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.4281732020070619,
      "grad_norm": 0.9419193267822266,
      "learning_rate": 1.295799391384136e-06,
      "loss": 0.2916,
      "mae_dtheta": 0.03754269331693649,
      "mae_dx": 0.008846702054142952,
      "mae_dy": 0.008587713353335857,
      "pose_mae_dtheta": 0.2728336453437805,
      "pose_mae_dx": 0.09016041457653046,
      "pose_mae_dy": 0.07474378496408463,
      "pose_rmse_dtheta": 0.47175946831703186,
      "pose_rmse_dx": 0.18014083802700043,
      "pose_rmse_dy": 0.16612905263900757,
      "pose_rmse_mean": 0.2726764678955078,
      "rmse_dtheta": 0.05462987720966339,
      "rmse_dx": 0.017551057040691376,
      "rmse_dy": 0.015641991049051285,
      "rmse_mean": 0.029274310916662216,
      "rotation_flip": 0.027499999850988388,
      "sparse_tokens": 6484.0,
      "step": 9216,
      "turn_loss": 0.34842243790626526,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.42821966177290466,
      "grad_norm": 0.32050663232803345,
      "learning_rate": 1.2949114109055417e-06,
      "loss": 0.0657,
      "mae_dtheta": 0.005963766481727362,
      "mae_dx": 0.0008959413389675319,
      "mae_dy": 0.0010804677149280906,
      "pose_mae_dtheta": 0.03962695598602295,
      "pose_mae_dx": 0.008512107655405998,
      "pose_mae_dy": 0.016617657616734505,
      "pose_rmse_dtheta": 0.08270449191331863,
      "pose_rmse_dx": 0.0223782267421484,
      "pose_rmse_dy": 0.038349442183971405,
      "pose_rmse_mean": 0.04781072586774826,
      "rmse_dtheta": 0.013083354569971561,
      "rmse_dx": 0.003117573680356145,
      "rmse_dy": 0.0026435856707394123,
      "rmse_mean": 0.0062815044075250626,
      "rotation_flip": 0.005125815514475107,
      "sparse_tokens": 32105.0,
      "step": 9217,
      "turn_loss": 0.0410802997648716,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.42826612153874744,
      "grad_norm": 0.38520923256874084,
      "learning_rate": 1.2940236895257824e-06,
      "loss": 0.0914,
      "mae_dtheta": 0.041405342519283295,
      "mae_dx": 0.01760462485253811,
      "mae_dy": 0.004412209149450064,
      "pose_mae_dtheta": 0.3232195973396301,
      "pose_mae_dx": 0.12267932295799255,
      "pose_mae_dy": 0.06167881563305855,
      "pose_rmse_dtheta": 0.6189218163490295,
      "pose_rmse_dx": 0.240489661693573,
      "pose_rmse_dy": 0.16191020607948303,
      "pose_rmse_mean": 0.340440571308136,
      "rmse_dtheta": 0.0631161704659462,
      "rmse_dx": 0.030617905780673027,
      "rmse_dy": 0.008397916331887245,
      "rmse_mean": 0.03404399752616882,
      "rotation_flip": 0.010723860934376717,
      "sparse_tokens": 6118.0,
      "step": 9218,
      "turn_loss": 0.3314281404018402,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4283125813045902,
      "grad_norm": 0.4799683392047882,
      "learning_rate": 1.2931362273069349e-06,
      "loss": 0.0826,
      "mae_dtheta": 0.005101910326629877,
      "mae_dx": 0.0009838453261181712,
      "mae_dy": 0.0010639240499585867,
      "pose_mae_dtheta": 0.03970242664217949,
      "pose_mae_dx": 0.008828340098261833,
      "pose_mae_dy": 0.014437464065849781,
      "pose_rmse_dtheta": 0.12611401081085205,
      "pose_rmse_dx": 0.021396327763795853,
      "pose_rmse_dy": 0.03111795336008072,
      "pose_rmse_mean": 0.05954276770353317,
      "rmse_dtheta": 0.013138143345713615,
      "rmse_dx": 0.002925987122580409,
      "rmse_dy": 0.002093446906656027,
      "rmse_mean": 0.0060525257140398026,
      "rotation_flip": 0.00303161540068686,
      "sparse_tokens": 32153.0,
      "step": 9219,
      "turn_loss": 0.03655432164669037,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.428359041070433,
      "grad_norm": 0.3523716330528259,
      "learning_rate": 1.2922490243110613e-06,
      "loss": 0.0807,
      "mae_dtheta": 0.008087240159511566,
      "mae_dx": 0.001281096483580768,
      "mae_dy": 0.0017034857301041484,
      "pose_mae_dtheta": 0.04899575933814049,
      "pose_mae_dx": 0.014797973446547985,
      "pose_mae_dy": 0.02095147781074047,
      "pose_rmse_dtheta": 0.10380987823009491,
      "pose_rmse_dx": 0.03856421634554863,
      "pose_rmse_dy": 0.04455910995602608,
      "pose_rmse_mean": 0.062311068177223206,
      "rmse_dtheta": 0.01608194410800934,
      "rmse_dx": 0.004115778487175703,
      "rmse_dy": 0.0033610891550779343,
      "rmse_mean": 0.007852938026189804,
      "rotation_flip": 0.0049151028506457806,
      "sparse_tokens": 32073.0,
      "step": 9220,
      "turn_loss": 0.06693120300769806,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.42840550083627577,
      "grad_norm": 0.5439701080322266,
      "learning_rate": 1.2913620806002026e-06,
      "loss": 0.0918,
      "mae_dtheta": 0.006644168868660927,
      "mae_dx": 0.0032782501075416803,
      "mae_dy": 0.0007985731936059892,
      "pose_mae_dtheta": 0.04977108910679817,
      "pose_mae_dx": 0.029435256496071815,
      "pose_mae_dy": 0.011542089283466339,
      "pose_rmse_dtheta": 0.1843380331993103,
      "pose_rmse_dx": 0.10075710713863373,
      "pose_rmse_dy": 0.03284458816051483,
      "pose_rmse_mean": 0.10597991943359375,
      "rmse_dtheta": 0.021898873150348663,
      "rmse_dx": 0.011162390001118183,
      "rmse_dy": 0.0023696008138358593,
      "rmse_mean": 0.011810287833213806,
      "rotation_flip": 0.0019212295301258564,
      "sparse_tokens": 32089.0,
      "step": 9221,
      "turn_loss": 0.05804651975631714,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16888.0,
      "epoch": 0.42845196060211854,
      "grad_norm": 0.513469398021698,
      "learning_rate": 1.2904753962363854e-06,
      "loss": 0.0977,
      "mae_dtheta": 0.017944930121302605,
      "mae_dx": 0.008553922176361084,
      "mae_dy": 0.002361774444580078,
      "pose_mae_dtheta": 0.1347050964832306,
      "pose_mae_dx": 0.07354535907506943,
      "pose_mae_dy": 0.04285401478409767,
      "pose_rmse_dtheta": 0.2842763364315033,
      "pose_rmse_dx": 0.21544724702835083,
      "pose_rmse_dy": 0.10091370344161987,
      "pose_rmse_mean": 0.20021244883537292,
      "rmse_dtheta": 0.033287063241004944,
      "rmse_dx": 0.022146128118038177,
      "rmse_dy": 0.0049091218970716,
      "rmse_mean": 0.020114105194807053,
      "rotation_flip": 0.007299270015209913,
      "sparse_tokens": 12579.0,
      "step": 9222,
      "turn_loss": 0.13759346306324005,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4284984203679613,
      "grad_norm": 0.46915531158447266,
      "learning_rate": 1.2895889712816129e-06,
      "loss": 0.1136,
      "mae_dtheta": 0.010024880059063435,
      "mae_dx": 0.0014038350200280547,
      "mae_dy": 0.002162378514185548,
      "pose_mae_dtheta": 0.06434807181358337,
      "pose_mae_dx": 0.01775679551064968,
      "pose_mae_dy": 0.02526981197297573,
      "pose_rmse_dtheta": 0.16247594356536865,
      "pose_rmse_dx": 0.050172463059425354,
      "pose_rmse_dy": 0.06299687176942825,
      "pose_rmse_mean": 0.09188176691532135,
      "rmse_dtheta": 0.021773288026452065,
      "rmse_dx": 0.004830066580325365,
      "rmse_dy": 0.0050259740091860294,
      "rmse_mean": 0.010543109849095345,
      "rotation_flip": 0.004302925895899534,
      "sparse_tokens": 32057.0,
      "step": 9223,
      "turn_loss": 0.0672464445233345,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.42854488013380415,
      "grad_norm": 0.5760000348091125,
      "learning_rate": 1.2887028057978756e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.04065928980708122,
      "mae_dx": 0.016686905175447464,
      "mae_dy": 0.004636208526790142,
      "pose_mae_dtheta": 0.3384670317173004,
      "pose_mae_dx": 0.14506086707115173,
      "pose_mae_dy": 0.06838741153478622,
      "pose_rmse_dtheta": 0.5690827369689941,
      "pose_rmse_dx": 0.3224945068359375,
      "pose_rmse_dy": 0.13903841376304626,
      "pose_rmse_mean": 0.3435385823249817,
      "rmse_dtheta": 0.05738913640379906,
      "rmse_dx": 0.03180159628391266,
      "rmse_dy": 0.00790740828961134,
      "rmse_mean": 0.03236604854464531,
      "rotation_flip": 0.007352941203862429,
      "sparse_tokens": 7761.0,
      "step": 9224,
      "turn_loss": 0.21405576169490814,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 29431.0,
      "epoch": 0.42859133989964693,
      "grad_norm": 0.727177083492279,
      "learning_rate": 1.2878168998471447e-06,
      "loss": 0.1682,
      "mae_dtheta": 0.04402980953454971,
      "mae_dx": 0.016091391444206238,
      "mae_dy": 0.008487527258694172,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7271773219108582,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.56710815429688,
      "model/head/act_norm_mean": 102.30241243131869,
      "model/head/act_norm_min": 60.18170928955078,
      "model/head/act_over_embed": 70.3031755930773,
      "model/head/grad_frac": 0.09837435930967331,
      "model/head/grad_norm": 0.07153560221195221,
      "model/head/grad_zero_frac": 9.930606756825e-05,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6971475789835165,
      "model/head/update_ratio": 0.001218074350617826,
      "model/head/weight_delta": 9.886083602905273,
      "model/head/weight_delta_rel": 0.1734311878681183,
      "model/head/weight_norm": 58.72843551635742,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42262211441993713,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42262211441993713,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42262211441993713,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29042987367995404,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06670866161584854,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04850902408361435,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015663665253669024,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1368844509124756,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10249178856611252,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969139099121094,
      "model/modality_embedder/grad_frac": 0.06670866161584854,
      "model/modality_embedder/grad_norm": 0.04850902408361435,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0015663665253669024,
      "model/modality_embedder/weight_delta": 3.1368844509124756,
      "model/modality_embedder/weight_delta_rel": 0.10249178856611252,
      "model/modality_embedder/weight_norm": 30.969139099121094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.211181640625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.944681558520845,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.13736343383789,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.767799978508686,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07157669961452484,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.052048951387405396,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00010591510363155976,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0018622265197336674,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.690338134765625,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09803754836320877,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.94985008239746,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.54085540771484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.711824633699635,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.4131441116333,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.294987881878175,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06831535696983337,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.049677375704050064,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00010087153350468725,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016696953680366278,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4108517169952393,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11815457046031952,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.75235939025879,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.81421661376953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.28202130211059,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.684021949768066,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.374041732823002,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0659661516547203,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.047969091683626175,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001561368117108941,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6921184062957764,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12397442013025284,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.72247314453125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.71080780029297,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.17607219169719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.570076942443848,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.675651236530722,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05511030554771423,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04007496312260628,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001338510075584054,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1697919368743896,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1083284467458725,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.939979553222656,
      "model/normalizer/grad_frac": 0.2015911489725113,
      "model/normalizer/grad_norm": 0.14659251272678375,
      "model/normalizer/grad_zero_frac": 0.00012762774713337421,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001864162040874362,
      "model/normalizer/weight_delta": 6.674884796142578,
      "model/normalizer/weight_delta_rel": 0.08596865087747574,
      "model/normalizer/weight_norm": 78.63721466064453,
      "pose_mae_dtheta": 0.364936888217926,
      "pose_mae_dx": 0.124721959233284,
      "pose_mae_dy": 0.08139785379171371,
      "pose_rmse_dtheta": 0.6373716592788696,
      "pose_rmse_dx": 0.25351497530937195,
      "pose_rmse_dy": 0.18849731981754303,
      "pose_rmse_mean": 0.3597946763038635,
      "rmse_dtheta": 0.06384656578302383,
      "rmse_dx": 0.029030589386820793,
      "rmse_dy": 0.017264334484934807,
      "rmse_mean": 0.03671383112668991,
      "rotation_flip": 0.014174344018101692,
      "sparse_tokens": 24633.0,
      "step": 9225,
      "turn_loss": 0.37045976519584656,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4286377996654897,
      "grad_norm": 0.3439841568470001,
      "learning_rate": 1.2869312534913686e-06,
      "loss": 0.0743,
      "mae_dtheta": 0.007119837217032909,
      "mae_dx": 0.0009622061043046415,
      "mae_dy": 0.0014093577628955245,
      "pose_mae_dtheta": 0.04590432718396187,
      "pose_mae_dx": 0.012946981936693192,
      "pose_mae_dy": 0.019724152982234955,
      "pose_rmse_dtheta": 0.11503363400697708,
      "pose_rmse_dx": 0.030636439099907875,
      "pose_rmse_dy": 0.04370703175663948,
      "pose_rmse_mean": 0.06312569975852966,
      "rmse_dtheta": 0.016228994354605675,
      "rmse_dx": 0.0030407242011278868,
      "rmse_dy": 0.00283531891182065,
      "rmse_mean": 0.007368345744907856,
      "rotation_flip": 0.004832863342016935,
      "sparse_tokens": 32089.0,
      "step": 9226,
      "turn_loss": 0.05700064077973366,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.4286842594313325,
      "grad_norm": 0.427921861410141,
      "learning_rate": 1.286045866792484e-06,
      "loss": 0.0874,
      "mae_dtheta": 0.033007409423589706,
      "mae_dx": 0.011449999175965786,
      "mae_dy": 0.0062989904545247555,
      "pose_mae_dtheta": 0.24595944583415985,
      "pose_mae_dx": 0.09235310554504395,
      "pose_mae_dy": 0.0700211152434349,
      "pose_rmse_dtheta": 0.4386172294616699,
      "pose_rmse_dx": 0.20845885574817657,
      "pose_rmse_dy": 0.16688036918640137,
      "pose_rmse_mean": 0.27131882309913635,
      "rmse_dtheta": 0.05148356407880783,
      "rmse_dx": 0.02362544648349285,
      "rmse_dy": 0.013626765459775925,
      "rmse_mean": 0.029578592628240585,
      "rotation_flip": 0.013474495150148869,
      "sparse_tokens": 16910.0,
      "step": 9227,
      "turn_loss": 0.30479276180267334,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.42873071919717526,
      "grad_norm": 0.345500648021698,
      "learning_rate": 1.2851607398124043e-06,
      "loss": 0.0718,
      "mae_dtheta": 0.02047037146985531,
      "mae_dx": 0.011244082823395729,
      "mae_dy": 0.0047286092303693295,
      "pose_mae_dtheta": 0.14766810834407806,
      "pose_mae_dx": 0.0829787626862526,
      "pose_mae_dy": 0.08277400583028793,
      "pose_rmse_dtheta": 0.2346380203962326,
      "pose_rmse_dx": 0.18271170556545258,
      "pose_rmse_dy": 0.17800797522068024,
      "pose_rmse_mean": 0.19845257699489594,
      "rmse_dtheta": 0.03196302056312561,
      "rmse_dx": 0.024379873648285866,
      "rmse_dy": 0.008598454296588898,
      "rmse_mean": 0.021647116169333458,
      "rotation_flip": 0.011520737782120705,
      "sparse_tokens": 8809.0,
      "step": 9228,
      "turn_loss": 0.2011861503124237,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.42877717896301804,
      "grad_norm": 0.4953305125236511,
      "learning_rate": 1.2842758726130283e-06,
      "loss": 0.1126,
      "mae_dtheta": 0.010784683749079704,
      "mae_dx": 0.0013504293747246265,
      "mae_dy": 0.00205664848908782,
      "pose_mae_dtheta": 0.06995272636413574,
      "pose_mae_dx": 0.018405241891741753,
      "pose_mae_dy": 0.026259928941726685,
      "pose_rmse_dtheta": 0.21033427119255066,
      "pose_rmse_dx": 0.04763656482100487,
      "pose_rmse_dy": 0.07893408834934235,
      "pose_rmse_mean": 0.11230164766311646,
      "rmse_dtheta": 0.027000289410352707,
      "rmse_dx": 0.0037924451753497124,
      "rmse_dy": 0.005004952196031809,
      "rmse_mean": 0.011932563036680222,
      "rotation_flip": 0.0032507111318409443,
      "sparse_tokens": 32105.0,
      "step": 9229,
      "turn_loss": 0.09406475722789764,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30818.0,
      "epoch": 0.4288236387288608,
      "grad_norm": 0.559208869934082,
      "learning_rate": 1.2833912652562358e-06,
      "loss": 0.0946,
      "mae_dtheta": 0.02696063555777073,
      "mae_dx": 0.009794846177101135,
      "mae_dy": 0.004714016802608967,
      "pose_mae_dtheta": 0.1993958055973053,
      "pose_mae_dx": 0.0748007595539093,
      "pose_mae_dy": 0.06114015355706215,
      "pose_rmse_dtheta": 0.38005611300468445,
      "pose_rmse_dx": 0.18057887256145477,
      "pose_rmse_dy": 0.16065675020217896,
      "pose_rmse_mean": 0.2404305785894394,
      "rmse_dtheta": 0.0438230000436306,
      "rmse_dx": 0.02167494408786297,
      "rmse_dy": 0.01059813518077135,
      "rmse_mean": 0.02536536008119583,
      "rotation_flip": 0.011227545328438282,
      "sparse_tokens": 24086.0,
      "step": 9230,
      "turn_loss": 0.24053430557250977,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4288700984947036,
      "grad_norm": 0.42573046684265137,
      "learning_rate": 1.2825069178038857e-06,
      "loss": 0.0945,
      "mae_dtheta": 0.013190747238695621,
      "mae_dx": 0.001446215552277863,
      "mae_dy": 0.002388486173003912,
      "pose_mae_dtheta": 0.0866958424448967,
      "pose_mae_dx": 0.025800207629799843,
      "pose_mae_dy": 0.034301359206438065,
      "pose_rmse_dtheta": 0.2067619115114212,
      "pose_rmse_dx": 0.06127442792057991,
      "pose_rmse_dy": 0.07789494097232819,
      "pose_rmse_mean": 0.1153104305267334,
      "rmse_dtheta": 0.02822771854698658,
      "rmse_dx": 0.00377567857503891,
      "rmse_dy": 0.00503798620775342,
      "rmse_mean": 0.012347127310931683,
      "rotation_flip": 0.0010496850591152906,
      "sparse_tokens": 32121.0,
      "step": 9231,
      "turn_loss": 0.10784852504730225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.42891655826054637,
      "grad_norm": 0.3043591380119324,
      "learning_rate": 1.2816228303178234e-06,
      "loss": 0.0747,
      "mae_dtheta": 0.030913706868886948,
      "mae_dx": 0.011886529624462128,
      "mae_dy": 0.004455930553376675,
      "pose_mae_dtheta": 0.23215565085411072,
      "pose_mae_dx": 0.07673726975917816,
      "pose_mae_dy": 0.05145663395524025,
      "pose_rmse_dtheta": 0.3921299874782562,
      "pose_rmse_dx": 0.18041792511940002,
      "pose_rmse_dy": 0.14546000957489014,
      "pose_rmse_mean": 0.23933598399162292,
      "rmse_dtheta": 0.049430154263973236,
      "rmse_dx": 0.02414063923060894,
      "rmse_dy": 0.011673711240291595,
      "rmse_mean": 0.028414836153388023,
      "rotation_flip": 0.01215277798473835,
      "sparse_tokens": 18934.0,
      "step": 9232,
      "turn_loss": 0.2635461986064911,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.42896301802638914,
      "grad_norm": 0.49403372406959534,
      "learning_rate": 1.2807390028598715e-06,
      "loss": 0.1276,
      "mae_dtheta": 0.03953714296221733,
      "mae_dx": 0.008619359694421291,
      "mae_dy": 0.002737876959145069,
      "pose_mae_dtheta": 0.3161724805831909,
      "pose_mae_dx": 0.062423329800367355,
      "pose_mae_dy": 0.031408850103616714,
      "pose_rmse_dtheta": 0.5807554125785828,
      "pose_rmse_dx": 0.14879901707172394,
      "pose_rmse_dy": 0.07835258543491364,
      "pose_rmse_mean": 0.2693023383617401,
      "rmse_dtheta": 0.06318013370037079,
      "rmse_dx": 0.018645312637090683,
      "rmse_dy": 0.00625590980052948,
      "rmse_mean": 0.02936045452952385,
      "rotation_flip": 0.011029412038624287,
      "sparse_tokens": 9512.0,
      "step": 9233,
      "turn_loss": 0.26856157183647156,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4290094777922319,
      "grad_norm": 0.5877480506896973,
      "learning_rate": 1.2798554354918386e-06,
      "loss": 0.1544,
      "mae_dtheta": 0.013455511070787907,
      "mae_dx": 0.0020206354092806578,
      "mae_dy": 0.002835145452991128,
      "pose_mae_dtheta": 0.10078597813844681,
      "pose_mae_dx": 0.026202455163002014,
      "pose_mae_dy": 0.033952176570892334,
      "pose_rmse_dtheta": 0.24704338610172272,
      "pose_rmse_dx": 0.06553644686937332,
      "pose_rmse_dy": 0.08514073491096497,
      "pose_rmse_mean": 0.13257353007793427,
      "rmse_dtheta": 0.02773338370025158,
      "rmse_dx": 0.005398161243647337,
      "rmse_dy": 0.006095065735280514,
      "rmse_mean": 0.013075537048280239,
      "rotation_flip": 0.0045854030176997185,
      "sparse_tokens": 32121.0,
      "step": 9234,
      "turn_loss": 0.11264751851558685,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14897.0,
      "epoch": 0.4290559375580747,
      "grad_norm": 0.5896131992340088,
      "learning_rate": 1.2789721282755102e-06,
      "loss": 0.1384,
      "mae_dtheta": 0.028168736025691032,
      "mae_dx": 0.01474734302610159,
      "mae_dy": 0.007012117654085159,
      "pose_mae_dtheta": 0.2240397036075592,
      "pose_mae_dx": 0.11253932118415833,
      "pose_mae_dy": 0.07092432677745819,
      "pose_rmse_dtheta": 0.4098718762397766,
      "pose_rmse_dx": 0.24620330333709717,
      "pose_rmse_dy": 0.17994678020477295,
      "pose_rmse_mean": 0.27867400646209717,
      "rmse_dtheta": 0.04550296440720558,
      "rmse_dx": 0.02813994139432907,
      "rmse_dy": 0.015453018248081207,
      "rmse_mean": 0.02969864383339882,
      "rotation_flip": 0.017214396968483925,
      "sparse_tokens": 12632.0,
      "step": 9235,
      "turn_loss": 0.27517491579055786,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.4291023973239175,
      "grad_norm": 0.6806349158287048,
      "learning_rate": 1.2780890812726576e-06,
      "loss": 0.1887,
      "mae_dtheta": 0.03246365487575531,
      "mae_dx": 0.013833539560437202,
      "mae_dy": 0.004624034743756056,
      "pose_mae_dtheta": 0.2877708971500397,
      "pose_mae_dx": 0.11215222626924515,
      "pose_mae_dy": 0.06368384510278702,
      "pose_rmse_dtheta": 0.5149709582328796,
      "pose_rmse_dx": 0.24148373305797577,
      "pose_rmse_dy": 0.144246444106102,
      "pose_rmse_mean": 0.30023372173309326,
      "rmse_dtheta": 0.05032995715737343,
      "rmse_dx": 0.026971522718667984,
      "rmse_dy": 0.008452053181827068,
      "rmse_mean": 0.02858451008796692,
      "rotation_flip": 0.004065040498971939,
      "sparse_tokens": 8300.0,
      "step": 9236,
      "turn_loss": 0.2514631152153015,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.42914885708976025,
      "grad_norm": 0.6369365453720093,
      "learning_rate": 1.2772062945450354e-06,
      "loss": 0.1019,
      "mae_dtheta": 0.031316302716732025,
      "mae_dx": 0.01586892455816269,
      "mae_dy": 0.010071240365505219,
      "pose_mae_dtheta": 0.21794649958610535,
      "pose_mae_dx": 0.10970553755760193,
      "pose_mae_dy": 0.13538822531700134,
      "pose_rmse_dtheta": 0.3535628318786621,
      "pose_rmse_dx": 0.19921492040157318,
      "pose_rmse_dy": 0.23397572338581085,
      "pose_rmse_mean": 0.2622511684894562,
      "rmse_dtheta": 0.04373493418097496,
      "rmse_dx": 0.02879941463470459,
      "rmse_dy": 0.015161741524934769,
      "rmse_mean": 0.029232030734419823,
      "rotation_flip": 0.009118541143834591,
      "sparse_tokens": 5620.0,
      "step": 9237,
      "turn_loss": 0.26814350485801697,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.429195316855603,
      "grad_norm": 0.5763269066810608,
      "learning_rate": 1.2763237681543732e-06,
      "loss": 0.18,
      "mae_dtheta": 0.03027208149433136,
      "mae_dx": 0.008653710596263409,
      "mae_dy": 0.00690853176638484,
      "pose_mae_dtheta": 0.21562708914279938,
      "pose_mae_dx": 0.07245984673500061,
      "pose_mae_dy": 0.06939490884542465,
      "pose_rmse_dtheta": 0.4315165877342224,
      "pose_rmse_dx": 0.17904353141784668,
      "pose_rmse_dy": 0.2176688015460968,
      "pose_rmse_mean": 0.2760763168334961,
      "rmse_dtheta": 0.05139864608645439,
      "rmse_dx": 0.019290372729301453,
      "rmse_dy": 0.018202397972345352,
      "rmse_mean": 0.029630472883582115,
      "rotation_flip": 0.011700468137860298,
      "sparse_tokens": 22199.0,
      "step": 9238,
      "turn_loss": 0.25189507007598877,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.4292417766214458,
      "grad_norm": 1.2730762958526611,
      "learning_rate": 1.2754415021623905e-06,
      "loss": 0.2728,
      "mae_dtheta": 0.037509217858314514,
      "mae_dx": 0.011817524209618568,
      "mae_dy": 0.00486056599766016,
      "pose_mae_dtheta": 0.3274676501750946,
      "pose_mae_dx": 0.10513734072446823,
      "pose_mae_dy": 0.07452815771102905,
      "pose_rmse_dtheta": 0.5898227095603943,
      "pose_rmse_dx": 0.24530069530010223,
      "pose_rmse_dy": 0.18062475323677063,
      "pose_rmse_mean": 0.33858272433280945,
      "rmse_dtheta": 0.059503618627786636,
      "rmse_dx": 0.024195443838834763,
      "rmse_dy": 0.011259966529905796,
      "rmse_mean": 0.03165300935506821,
      "rotation_flip": 0.0033444815780967474,
      "sparse_tokens": 5708.0,
      "step": 9239,
      "turn_loss": 0.22735010087490082,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.42928823638728864,
      "grad_norm": 0.4434111416339874,
      "learning_rate": 1.2745594966307823e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.028849706053733826,
      "mae_dx": 0.012732701376080513,
      "mae_dy": 0.004661997780203819,
      "pose_mae_dtheta": 0.2107243835926056,
      "pose_mae_dx": 0.09391683340072632,
      "pose_mae_dy": 0.06387969851493835,
      "pose_rmse_dtheta": 0.40813738107681274,
      "pose_rmse_dx": 0.2310381382703781,
      "pose_rmse_dy": 0.1729341447353363,
      "pose_rmse_mean": 0.2707032561302185,
      "rmse_dtheta": 0.04730972647666931,
      "rmse_dx": 0.02603837288916111,
      "rmse_dy": 0.009586285799741745,
      "rmse_mean": 0.027644794434309006,
      "rotation_flip": 0.00594530301168561,
      "sparse_tokens": 15166.0,
      "step": 9240,
      "turn_loss": 0.29566213488578796,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.4293346961531314,
      "grad_norm": 0.5755141973495483,
      "learning_rate": 1.2736777516212267e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.029048720374703407,
      "mae_dx": 0.012119405902922153,
      "mae_dy": 0.003445869777351618,
      "pose_mae_dtheta": 0.2328263521194458,
      "pose_mae_dx": 0.10159381479024887,
      "pose_mae_dy": 0.05063948035240173,
      "pose_rmse_dtheta": 0.45482519268989563,
      "pose_rmse_dx": 0.25313255190849304,
      "pose_rmse_dy": 0.11624567210674286,
      "pose_rmse_mean": 0.2747344970703125,
      "rmse_dtheta": 0.04875119403004646,
      "rmse_dx": 0.026180529966950417,
      "rmse_dy": 0.0065553816966712475,
      "rmse_mean": 0.027162369340658188,
      "rotation_flip": 0.0063492064364254475,
      "sparse_tokens": 12354.0,
      "step": 9241,
      "turn_loss": 0.24796642363071442,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.4293811559189742,
      "grad_norm": 0.5211708545684814,
      "learning_rate": 1.2727962671953874e-06,
      "loss": 0.0582,
      "mae_dtheta": 0.03695216774940491,
      "mae_dx": 0.014690459705889225,
      "mae_dy": 0.007555891294032335,
      "pose_mae_dtheta": 0.2764882743358612,
      "pose_mae_dx": 0.10520873218774796,
      "pose_mae_dy": 0.12056172639131546,
      "pose_rmse_dtheta": 0.46601995825767517,
      "pose_rmse_dx": 0.2213331162929535,
      "pose_rmse_dy": 0.2334047555923462,
      "pose_rmse_mean": 0.30691927671432495,
      "rmse_dtheta": 0.05301892012357712,
      "rmse_dx": 0.02919839136302471,
      "rmse_dy": 0.012207300402224064,
      "rmse_mean": 0.031474873423576355,
      "rotation_flip": 0.012145749293267727,
      "sparse_tokens": 4271.0,
      "step": 9242,
      "turn_loss": 0.2989136278629303,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.42942761568481697,
      "grad_norm": 0.6020122766494751,
      "learning_rate": 1.2719150434149048e-06,
      "loss": 0.1201,
      "mae_dtheta": 0.033430781215429306,
      "mae_dx": 0.008875705301761627,
      "mae_dy": 0.004105345346033573,
      "pose_mae_dtheta": 0.2675589323043823,
      "pose_mae_dx": 0.06796009093523026,
      "pose_mae_dy": 0.04967879876494408,
      "pose_rmse_dtheta": 0.47607743740081787,
      "pose_rmse_dx": 0.16498813033103943,
      "pose_rmse_dy": 0.11108554154634476,
      "pose_rmse_mean": 0.25071704387664795,
      "rmse_dtheta": 0.05221862345933914,
      "rmse_dx": 0.019381923601031303,
      "rmse_dy": 0.007346538361161947,
      "rmse_mean": 0.02631569653749466,
      "rotation_flip": 0.018359852954745293,
      "sparse_tokens": 14972.0,
      "step": 9243,
      "turn_loss": 0.238414466381073,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.42947407545065974,
      "grad_norm": 0.5733479261398315,
      "learning_rate": 1.2710340803414046e-06,
      "loss": 0.096,
      "mae_dtheta": 0.05191094055771828,
      "mae_dx": 0.010737712495028973,
      "mae_dy": 0.002900106366723776,
      "pose_mae_dtheta": 0.4026438891887665,
      "pose_mae_dx": 0.05934679135680199,
      "pose_mae_dy": 0.03512559086084366,
      "pose_rmse_dtheta": 0.7096725106239319,
      "pose_rmse_dx": 0.14199182391166687,
      "pose_rmse_dy": 0.0836176648736,
      "pose_rmse_mean": 0.31176066398620605,
      "rmse_dtheta": 0.0746300220489502,
      "rmse_dx": 0.022268246859312057,
      "rmse_dy": 0.00579300569370389,
      "rmse_mean": 0.03423042595386505,
      "rotation_flip": 0.019543973729014397,
      "sparse_tokens": 5391.0,
      "step": 9244,
      "turn_loss": 0.21318644285202026,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.4295205352165025,
      "grad_norm": 0.9939079284667969,
      "learning_rate": 1.2701533780364917e-06,
      "loss": 0.2065,
      "mae_dtheta": 0.032631754875183105,
      "mae_dx": 0.011011837981641293,
      "mae_dy": 0.004633333068341017,
      "pose_mae_dtheta": 0.27141866087913513,
      "pose_mae_dx": 0.08697178214788437,
      "pose_mae_dy": 0.04388462007045746,
      "pose_rmse_dtheta": 0.5468123555183411,
      "pose_rmse_dx": 0.23056727647781372,
      "pose_rmse_dy": 0.09569739550352097,
      "pose_rmse_mean": 0.29102569818496704,
      "rmse_dtheta": 0.0553506501019001,
      "rmse_dx": 0.024262119084596634,
      "rmse_dy": 0.00973423570394516,
      "rmse_mean": 0.029782336205244064,
      "rotation_flip": 0.013100436888635159,
      "sparse_tokens": 8259.0,
      "step": 9245,
      "turn_loss": 0.23913602530956268,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4295669949823453,
      "grad_norm": 0.4713343381881714,
      "learning_rate": 1.2692729365617568e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.009774592705070972,
      "mae_dx": 0.0015271827578544617,
      "mae_dy": 0.0025915876030921936,
      "pose_mae_dtheta": 0.06725166738033295,
      "pose_mae_dx": 0.019856898114085197,
      "pose_mae_dy": 0.02578352764248848,
      "pose_rmse_dtheta": 0.17409758269786835,
      "pose_rmse_dx": 0.05039726570248604,
      "pose_rmse_dy": 0.05384096875786781,
      "pose_rmse_mean": 0.09277860820293427,
      "rmse_dtheta": 0.022221649065613747,
      "rmse_dx": 0.004175085108727217,
      "rmse_dy": 0.005346369463950396,
      "rmse_mean": 0.010581035166978836,
      "rotation_flip": 0.0032667876221239567,
      "sparse_tokens": 32121.0,
      "step": 9246,
      "turn_loss": 0.07339317351579666,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13282.0,
      "epoch": 0.4296134547481881,
      "grad_norm": 0.6734828948974609,
      "learning_rate": 1.2683927559787657e-06,
      "loss": 0.1322,
      "mae_dtheta": 0.043835509568452835,
      "mae_dx": 0.017631124705076218,
      "mae_dy": 0.0041184332221746445,
      "pose_mae_dtheta": 0.36478933691978455,
      "pose_mae_dx": 0.1431136578321457,
      "pose_mae_dy": 0.05365945026278496,
      "pose_rmse_dtheta": 0.6348706483840942,
      "pose_rmse_dx": 0.3186027705669403,
      "pose_rmse_dy": 0.1203555315732956,
      "pose_rmse_mean": 0.35794299840927124,
      "rmse_dtheta": 0.06510823220014572,
      "rmse_dx": 0.03322409838438034,
      "rmse_dy": 0.008110248483717442,
      "rmse_mean": 0.035480860620737076,
      "rotation_flip": 0.008077544160187244,
      "sparse_tokens": 10321.0,
      "step": 9247,
      "turn_loss": 0.24144619703292847,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.42965991451403085,
      "grad_norm": 0.339190810918808,
      "learning_rate": 1.2675128363490724e-06,
      "loss": 0.0893,
      "mae_dtheta": 0.008321910165250301,
      "mae_dx": 0.0016152838943526149,
      "mae_dy": 0.0008893132326193154,
      "pose_mae_dtheta": 0.058780595660209656,
      "pose_mae_dx": 0.015797417610883713,
      "pose_mae_dy": 0.013157553039491177,
      "pose_rmse_dtheta": 0.19198331236839294,
      "pose_rmse_dx": 0.04046725854277611,
      "pose_rmse_dy": 0.03341859579086304,
      "pose_rmse_mean": 0.0886230617761612,
      "rmse_dtheta": 0.023998232558369637,
      "rmse_dx": 0.005227718967944384,
      "rmse_dy": 0.0020077861845493317,
      "rmse_mean": 0.010411245748400688,
      "rotation_flip": 0.0017772511346265674,
      "sparse_tokens": 32121.0,
      "step": 9248,
      "turn_loss": 0.07630784809589386,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12675.0,
      "epoch": 0.4297063742798736,
      "grad_norm": 0.7226948738098145,
      "learning_rate": 1.2666331777342112e-06,
      "loss": 0.22,
      "mae_dtheta": 0.029827149584889412,
      "mae_dx": 0.008974201045930386,
      "mae_dy": 0.006400335114449263,
      "pose_mae_dtheta": 0.22583623230457306,
      "pose_mae_dx": 0.05794434994459152,
      "pose_mae_dy": 0.07591105252504349,
      "pose_rmse_dtheta": 0.4327877461910248,
      "pose_rmse_dx": 0.12523895502090454,
      "pose_rmse_dy": 0.16826240718364716,
      "pose_rmse_mean": 0.24209636449813843,
      "rmse_dtheta": 0.049000367522239685,
      "rmse_dx": 0.01971208117902279,
      "rmse_dy": 0.012652448378503323,
      "rmse_mean": 0.027121633291244507,
      "rotation_flip": 0.00917431153357029,
      "sparse_tokens": 10752.0,
      "step": 9249,
      "turn_loss": 0.2550695240497589,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 16837.0,
      "epoch": 0.4297528340457164,
      "grad_norm": 0.6041910648345947,
      "learning_rate": 1.2657537801956943e-06,
      "loss": 0.126,
      "mae_dtheta": 0.028686927631497383,
      "mae_dx": 0.0077437832951545715,
      "mae_dy": 0.0020459366496652365,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6041911244392395,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 132.5054168701172,
      "model/head/act_norm_mean": 104.8352801983173,
      "model/head/act_norm_min": 71.05309295654297,
      "model/head/act_over_embed": 72.0437860356404,
      "model/head/grad_frac": 0.09116648882627487,
      "model/head/grad_norm": 0.05508198216557503,
      "model/head/grad_zero_frac": 0.00019226668518967927,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6999136117788461,
      "model/head/update_ratio": 0.0009379028342664242,
      "model/head/weight_delta": 9.88855266571045,
      "model/head/weight_delta_rel": 0.1734745055437088,
      "model/head/weight_norm": 58.728878021240234,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42260947823524475,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42260947823524475,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42260947823524475,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904211899755316,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08302298188209534,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05016174912452698,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016197353834286332,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1374032497406006,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10250874608755112,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969100952148438,
      "model/modality_embedder/grad_frac": 0.08302298188209534,
      "model/modality_embedder/grad_norm": 0.05016174912452698,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0016197353834286332,
      "model/modality_embedder/weight_delta": 3.1374032497406006,
      "model/modality_embedder/weight_delta_rel": 0.10250874608755112,
      "model/modality_embedder/weight_norm": 30.969100952148438,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.93732452392578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.090027377136753,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.072972297668457,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.86768298581053,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06724698841571808,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0406300313770771,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001453661941923201,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.69160795211792,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09808381646871567,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.950122833251953,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 77.03903198242188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.884801396520146,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.688623428344727,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.4138591327224,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06724786013364792,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.040630560368299484,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013655987568199635,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4125218391418457,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11821242421865463,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.752927780151367,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.30951690673828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.493980845543344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.899090766906738,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.519702315466503,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06330467015504837,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03824811801314354,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001244931947439909,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6940650939941406,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12403979152441025,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.723058700561523,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 78.75224304199219,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.289446447649574,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.779387474060059,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.753563086647706,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06499053537845612,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03926670551300049,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013114989269524813,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1714441776275635,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10838491469621658,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.940324783325195,
      "model/normalizer/grad_frac": 0.2422744631767273,
      "model/normalizer/grad_norm": 0.14638008177280426,
      "model/normalizer/grad_zero_frac": 0.00023043899273034185,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018614467699080706,
      "model/normalizer/weight_delta": 6.678275108337402,
      "model/normalizer/weight_delta_rel": 0.08601231873035431,
      "model/normalizer/weight_norm": 78.63780212402344,
      "pose_mae_dtheta": 0.2363303303718567,
      "pose_mae_dx": 0.05729943513870239,
      "pose_mae_dy": 0.023055724799633026,
      "pose_rmse_dtheta": 0.46803849935531616,
      "pose_rmse_dx": 0.16127364337444305,
      "pose_rmse_dy": 0.060941118746995926,
      "pose_rmse_mean": 0.23008441925048828,
      "rmse_dtheta": 0.04907894879579544,
      "rmse_dx": 0.018690109252929688,
      "rmse_dy": 0.004121005069464445,
      "rmse_mean": 0.023963354527950287,
      "rotation_flip": 0.005763688590377569,
      "sparse_tokens": 13168.0,
      "step": 9250,
      "turn_loss": 0.23127105832099915,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4297992938115592,
      "grad_norm": 0.6063260436058044,
      "learning_rate": 1.264874643795021e-06,
      "loss": 0.1769,
      "mae_dtheta": 0.009911331348121166,
      "mae_dx": 0.0027759354561567307,
      "mae_dy": 0.0018725963309407234,
      "pose_mae_dtheta": 0.06184010207653046,
      "pose_mae_dx": 0.029332220554351807,
      "pose_mae_dy": 0.018588410690426826,
      "pose_rmse_dtheta": 0.16642065346240997,
      "pose_rmse_dx": 0.07248374074697495,
      "pose_rmse_dy": 0.040567219257354736,
      "pose_rmse_mean": 0.09315720200538635,
      "rmse_dtheta": 0.024087728932499886,
      "rmse_dx": 0.00839222315698862,
      "rmse_dy": 0.004505085293203592,
      "rmse_mean": 0.012328347191214561,
      "rotation_flip": 0.0017652250826358795,
      "sparse_tokens": 32105.0,
      "step": 9251,
      "turn_loss": 0.12097398936748505,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.42984575357740196,
      "grad_norm": 0.6311902403831482,
      "learning_rate": 1.2639957685936676e-06,
      "loss": 0.1799,
      "mae_dtheta": 0.03332970291376114,
      "mae_dx": 0.012299768626689911,
      "mae_dy": 0.00806486327201128,
      "pose_mae_dtheta": 0.23466059565544128,
      "pose_mae_dx": 0.08966100215911865,
      "pose_mae_dy": 0.07972729206085205,
      "pose_rmse_dtheta": 0.42525532841682434,
      "pose_rmse_dx": 0.19201982021331787,
      "pose_rmse_dy": 0.18850301206111908,
      "pose_rmse_mean": 0.2685927152633667,
      "rmse_dtheta": 0.05047398805618286,
      "rmse_dx": 0.024160588160157204,
      "rmse_dy": 0.017278775572776794,
      "rmse_mean": 0.03063778392970562,
      "rotation_flip": 0.011579818092286587,
      "sparse_tokens": 21066.0,
      "step": 9252,
      "turn_loss": 0.3448571264743805,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.42989221334324473,
      "grad_norm": 0.4948621094226837,
      "learning_rate": 1.263117154653097e-06,
      "loss": 0.107,
      "mae_dtheta": 0.012258271686732769,
      "mae_dx": 0.0022725926246494055,
      "mae_dy": 0.0032085853163152933,
      "pose_mae_dtheta": 0.08161832392215729,
      "pose_mae_dx": 0.030312495306134224,
      "pose_mae_dy": 0.033163975924253464,
      "pose_rmse_dtheta": 0.18029507994651794,
      "pose_rmse_dx": 0.09037808328866959,
      "pose_rmse_dy": 0.07573924958705902,
      "pose_rmse_mean": 0.11547081172466278,
      "rmse_dtheta": 0.02439199946820736,
      "rmse_dx": 0.006824345327913761,
      "rmse_dy": 0.00787095446139574,
      "rmse_mean": 0.013029100373387337,
      "rotation_flip": 0.009305655024945736,
      "sparse_tokens": 32089.0,
      "step": 9253,
      "turn_loss": 0.10125306993722916,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.4299386731090875,
      "grad_norm": 0.6132391691207886,
      "learning_rate": 1.2622388020347475e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.0177156962454319,
      "mae_dx": 0.010484314523637295,
      "mae_dy": 0.0036590881645679474,
      "pose_mae_dtheta": 0.15055015683174133,
      "pose_mae_dx": 0.08919951319694519,
      "pose_mae_dy": 0.07529223710298538,
      "pose_rmse_dtheta": 0.2975826859474182,
      "pose_rmse_dx": 0.23939581215381622,
      "pose_rmse_dy": 0.17662902176380157,
      "pose_rmse_mean": 0.23786917328834534,
      "rmse_dtheta": 0.031540099531412125,
      "rmse_dx": 0.025811223313212395,
      "rmse_dy": 0.006779682822525501,
      "rmse_mean": 0.02137700282037258,
      "rotation_flip": 0.008379888720810413,
      "sparse_tokens": 8546.0,
      "step": 9254,
      "turn_loss": 0.13300691545009613,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4299851328749303,
      "grad_norm": 0.44951942563056946,
      "learning_rate": 1.2613607108000447e-06,
      "loss": 0.0924,
      "mae_dtheta": 0.010221084579825401,
      "mae_dx": 0.001776986406184733,
      "mae_dy": 0.002527182921767235,
      "pose_mae_dtheta": 0.06695574522018433,
      "pose_mae_dx": 0.020923668518662453,
      "pose_mae_dy": 0.028278253972530365,
      "pose_rmse_dtheta": 0.13202857971191406,
      "pose_rmse_dx": 0.054128989577293396,
      "pose_rmse_dy": 0.0594777874648571,
      "pose_rmse_mean": 0.08187845349311829,
      "rmse_dtheta": 0.020166706293821335,
      "rmse_dx": 0.0053823161870241165,
      "rmse_dy": 0.0058041950687766075,
      "rmse_mean": 0.010451072826981544,
      "rotation_flip": 0.0058958400040864944,
      "sparse_tokens": 32121.0,
      "step": 9255,
      "turn_loss": 0.08683029562234879,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.43003159264077306,
      "grad_norm": 0.41630440950393677,
      "learning_rate": 1.260482881010396e-06,
      "loss": 0.1027,
      "mae_dtheta": 0.025363393127918243,
      "mae_dx": 0.00881625059992075,
      "mae_dy": 0.0036821605172008276,
      "pose_mae_dtheta": 0.19446802139282227,
      "pose_mae_dx": 0.08604858815670013,
      "pose_mae_dy": 0.034481801092624664,
      "pose_rmse_dtheta": 0.39198121428489685,
      "pose_rmse_dx": 0.17613284289836884,
      "pose_rmse_dy": 0.07370281964540482,
      "pose_rmse_mean": 0.21393895149230957,
      "rmse_dtheta": 0.042650219053030014,
      "rmse_dx": 0.0178290493786335,
      "rmse_dy": 0.007636058144271374,
      "rmse_mean": 0.022705107927322388,
      "rotation_flip": 0.012376237660646439,
      "sparse_tokens": 6794.0,
      "step": 9256,
      "turn_loss": 0.19755971431732178,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.4300780524066159,
      "grad_norm": 0.6086103320121765,
      "learning_rate": 1.2596053127271845e-06,
      "loss": 0.1491,
      "mae_dtheta": 0.0314357727766037,
      "mae_dx": 0.01107884757220745,
      "mae_dy": 0.002472382504492998,
      "pose_mae_dtheta": 0.21751455962657928,
      "pose_mae_dx": 0.09434380382299423,
      "pose_mae_dy": 0.024363256990909576,
      "pose_rmse_dtheta": 0.41907641291618347,
      "pose_rmse_dx": 0.2115904688835144,
      "pose_rmse_dy": 0.06507378816604614,
      "pose_rmse_mean": 0.23191355168819427,
      "rmse_dtheta": 0.05040788650512695,
      "rmse_dx": 0.023316847160458565,
      "rmse_dy": 0.005390661768615246,
      "rmse_mean": 0.026371797546744347,
      "rotation_flip": 0.017951425164937973,
      "sparse_tokens": 15826.0,
      "step": 9257,
      "turn_loss": 0.2312774360179901,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4301245121724587,
      "grad_norm": 0.359595388174057,
      "learning_rate": 1.258728006011783e-06,
      "loss": 0.0685,
      "mae_dtheta": 0.006958073005080223,
      "mae_dx": 0.0009962767362594604,
      "mae_dy": 0.0010278646368533373,
      "pose_mae_dtheta": 0.04037605971097946,
      "pose_mae_dx": 0.011107593774795532,
      "pose_mae_dy": 0.014859646558761597,
      "pose_rmse_dtheta": 0.12275654077529907,
      "pose_rmse_dx": 0.026913348585367203,
      "pose_rmse_dy": 0.03890874236822128,
      "pose_rmse_mean": 0.06285955011844635,
      "rmse_dtheta": 0.017542021349072456,
      "rmse_dx": 0.003000834956765175,
      "rmse_dy": 0.002275084378197789,
      "rmse_mean": 0.0076059806160628796,
      "rotation_flip": 0.006057782098650932,
      "sparse_tokens": 32137.0,
      "step": 9258,
      "turn_loss": 0.05982691049575806,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.43017097193830145,
      "grad_norm": 0.7745471000671387,
      "learning_rate": 1.2578509609255385e-06,
      "loss": 0.1923,
      "mae_dtheta": 0.02887658216059208,
      "mae_dx": 0.012428156100213528,
      "mae_dy": 0.00575999403372407,
      "pose_mae_dtheta": 0.21515214443206787,
      "pose_mae_dx": 0.08435697108507156,
      "pose_mae_dy": 0.0698578879237175,
      "pose_rmse_dtheta": 0.37245678901672363,
      "pose_rmse_dx": 0.2025710493326187,
      "pose_rmse_dy": 0.1797477900981903,
      "pose_rmse_mean": 0.25159189105033875,
      "rmse_dtheta": 0.04561501741409302,
      "rmse_dx": 0.025834299623966217,
      "rmse_dy": 0.012102351523935795,
      "rmse_mean": 0.02785055711865425,
      "rotation_flip": 0.010126582346856594,
      "sparse_tokens": 15379.0,
      "step": 9259,
      "turn_loss": 0.24579550325870514,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4302174317041442,
      "grad_norm": 0.41665270924568176,
      "learning_rate": 1.256974177529786e-06,
      "loss": 0.1123,
      "mae_dtheta": 0.009858300909399986,
      "mae_dx": 0.0022089737467467785,
      "mae_dy": 0.0031108299735933542,
      "pose_mae_dtheta": 0.0653078630566597,
      "pose_mae_dx": 0.02380252815783024,
      "pose_mae_dy": 0.025890972465276718,
      "pose_rmse_dtheta": 0.17600691318511963,
      "pose_rmse_dx": 0.05681771785020828,
      "pose_rmse_dy": 0.06207575649023056,
      "pose_rmse_mean": 0.09830012917518616,
      "rmse_dtheta": 0.02339928224682808,
      "rmse_dx": 0.0057037896476686,
      "rmse_dy": 0.007607394829392433,
      "rmse_mean": 0.0122368223965168,
      "rotation_flip": 0.005522682331502438,
      "sparse_tokens": 32105.0,
      "step": 9260,
      "turn_loss": 0.09392557293176651,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35256.0,
      "epoch": 0.430263891469987,
      "grad_norm": 0.35449665784835815,
      "learning_rate": 1.2560976558858372e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.03321259468793869,
      "mae_dx": 0.012487642467021942,
      "mae_dy": 0.004937386140227318,
      "pose_mae_dtheta": 0.26622048020362854,
      "pose_mae_dx": 0.09124113619327545,
      "pose_mae_dy": 0.07447181642055511,
      "pose_rmse_dtheta": 0.4298197329044342,
      "pose_rmse_dx": 0.2033296376466751,
      "pose_rmse_dy": 0.17991341650485992,
      "pose_rmse_mean": 0.27102094888687134,
      "rmse_dtheta": 0.048595212399959564,
      "rmse_dx": 0.025081099942326546,
      "rmse_dy": 0.008876042440533638,
      "rmse_mean": 0.027517450973391533,
      "rotation_flip": 0.012125079520046711,
      "sparse_tokens": 27354.0,
      "step": 9261,
      "turn_loss": 0.2625092566013336,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4303103512358298,
      "grad_norm": 0.38002756237983704,
      "learning_rate": 1.2552213960549891e-06,
      "loss": 0.0805,
      "mae_dtheta": 0.006260937545448542,
      "mae_dx": 0.001179582322947681,
      "mae_dy": 0.0007204102585092187,
      "pose_mae_dtheta": 0.043274469673633575,
      "pose_mae_dx": 0.01088088657706976,
      "pose_mae_dy": 0.009860171005129814,
      "pose_rmse_dtheta": 0.15806424617767334,
      "pose_rmse_dx": 0.02661408856511116,
      "pose_rmse_dy": 0.02875334955751896,
      "pose_rmse_mean": 0.07114389538764954,
      "rmse_dtheta": 0.020184049382805824,
      "rmse_dx": 0.0034372112713754177,
      "rmse_dy": 0.0018452961230650544,
      "rmse_mean": 0.00848885253071785,
      "rotation_flip": 0.0023062729742377996,
      "sparse_tokens": 32185.0,
      "step": 9262,
      "turn_loss": 0.04252452403306961,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.43035681100167256,
      "grad_norm": 0.48247456550598145,
      "learning_rate": 1.2543453980985198e-06,
      "loss": 0.1032,
      "mae_dtheta": 0.011740436777472496,
      "mae_dx": 0.0013507563853636384,
      "mae_dy": 0.002385342726483941,
      "pose_mae_dtheta": 0.07580147683620453,
      "pose_mae_dx": 0.016886470839381218,
      "pose_mae_dy": 0.028941867873072624,
      "pose_rmse_dtheta": 0.18269680440425873,
      "pose_rmse_dx": 0.04155538231134415,
      "pose_rmse_dy": 0.05992855876684189,
      "pose_rmse_mean": 0.09472692012786865,
      "rmse_dtheta": 0.024369975551962852,
      "rmse_dx": 0.00402397196739912,
      "rmse_dy": 0.004994014278054237,
      "rmse_mean": 0.011129319667816162,
      "rotation_flip": 0.0045028142631053925,
      "sparse_tokens": 32105.0,
      "step": 9263,
      "turn_loss": 0.08116830885410309,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.43040327076751533,
      "grad_norm": 0.5914260149002075,
      "learning_rate": 1.2534696620776858e-06,
      "loss": 0.1183,
      "mae_dtheta": 0.0054594408720731735,
      "mae_dx": 0.0016810707747936249,
      "mae_dy": 0.0009349797619506717,
      "pose_mae_dtheta": 0.03716190904378891,
      "pose_mae_dx": 0.015755901113152504,
      "pose_mae_dy": 0.011236737482249737,
      "pose_rmse_dtheta": 0.1146373376250267,
      "pose_rmse_dx": 0.04118511825799942,
      "pose_rmse_dy": 0.02943948097527027,
      "pose_rmse_mean": 0.061753980815410614,
      "rmse_dtheta": 0.0189998559653759,
      "rmse_dx": 0.005148844327777624,
      "rmse_dy": 0.0034621870145201683,
      "rmse_mean": 0.009203629568219185,
      "rotation_flip": 0.0017564402660354972,
      "sparse_tokens": 32153.0,
      "step": 9264,
      "turn_loss": 0.05776963010430336,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.4304497305333581,
      "grad_norm": 0.4747071862220764,
      "learning_rate": 1.2525941880537307e-06,
      "loss": 0.124,
      "mae_dtheta": 0.0317738875746727,
      "mae_dx": 0.010125720873475075,
      "mae_dy": 0.0029033422470092773,
      "pose_mae_dtheta": 0.2201249599456787,
      "pose_mae_dx": 0.06392592191696167,
      "pose_mae_dy": 0.03531059995293617,
      "pose_rmse_dtheta": 0.4015936851501465,
      "pose_rmse_dx": 0.14184226095676422,
      "pose_rmse_dy": 0.09938185662031174,
      "pose_rmse_mean": 0.214272603392601,
      "rmse_dtheta": 0.05063851177692413,
      "rmse_dx": 0.02142609842121601,
      "rmse_dy": 0.00662726815789938,
      "rmse_mean": 0.026230625808238983,
      "rotation_flip": 0.004761904943734407,
      "sparse_tokens": 7019.0,
      "step": 9265,
      "turn_loss": 0.22528263926506042,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4304961902992009,
      "grad_norm": 0.42315205931663513,
      "learning_rate": 1.251718976087874e-06,
      "loss": 0.073,
      "mae_dtheta": 0.009382239542901516,
      "mae_dx": 0.0011810550931841135,
      "mae_dy": 0.002293757861480117,
      "pose_mae_dtheta": 0.05480751022696495,
      "pose_mae_dx": 0.017778193578124046,
      "pose_mae_dy": 0.027454834431409836,
      "pose_rmse_dtheta": 0.09658745676279068,
      "pose_rmse_dx": 0.04730633273720741,
      "pose_rmse_dy": 0.0578482486307621,
      "pose_rmse_mean": 0.06724734604358673,
      "rmse_dtheta": 0.01691312901675701,
      "rmse_dx": 0.004198078997433186,
      "rmse_dy": 0.004693143535405397,
      "rmse_mean": 0.00860145129263401,
      "rotation_flip": 0.008931761607527733,
      "sparse_tokens": 32057.0,
      "step": 9266,
      "turn_loss": 0.07753760367631912,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.43054265006504366,
      "grad_norm": 0.4448932111263275,
      "learning_rate": 1.2508440262413207e-06,
      "loss": 0.1106,
      "mae_dtheta": 0.035251401364803314,
      "mae_dx": 0.010870781727135181,
      "mae_dy": 0.003641522955149412,
      "pose_mae_dtheta": 0.26035264134407043,
      "pose_mae_dx": 0.08514050394296646,
      "pose_mae_dy": 0.04653419181704521,
      "pose_rmse_dtheta": 0.495491087436676,
      "pose_rmse_dx": 0.18424205482006073,
      "pose_rmse_dy": 0.11258134990930557,
      "pose_rmse_mean": 0.26410484313964844,
      "rmse_dtheta": 0.05742208659648895,
      "rmse_dx": 0.02188362181186676,
      "rmse_dy": 0.00732454052194953,
      "rmse_mean": 0.02887674979865551,
      "rotation_flip": 0.013720742426812649,
      "sparse_tokens": 22436.0,
      "step": 9267,
      "turn_loss": 0.2846827507019043,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.43058910983088644,
      "grad_norm": 0.5689173340797424,
      "learning_rate": 1.2499693385752587e-06,
      "loss": 0.1481,
      "mae_dtheta": 0.008892294950783253,
      "mae_dx": 0.001040862058289349,
      "mae_dy": 0.0021516974084079266,
      "pose_mae_dtheta": 0.055650606751441956,
      "pose_mae_dx": 0.015276770107448101,
      "pose_mae_dy": 0.02322412095963955,
      "pose_rmse_dtheta": 0.13535656034946442,
      "pose_rmse_dx": 0.041739657521247864,
      "pose_rmse_dy": 0.054031793028116226,
      "pose_rmse_mean": 0.07704266905784607,
      "rmse_dtheta": 0.018863758072257042,
      "rmse_dx": 0.0032347573433071375,
      "rmse_dy": 0.00543418200686574,
      "rmse_mean": 0.009177565574645996,
      "rotation_flip": 0.003599999938160181,
      "sparse_tokens": 32089.0,
      "step": 9268,
      "turn_loss": 0.06841026991605759,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.4306355695967292,
      "grad_norm": 0.4591237008571625,
      "learning_rate": 1.2490949131508522e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.02900383621454239,
      "mae_dx": 0.00519659323617816,
      "mae_dy": 0.004971907939761877,
      "pose_mae_dtheta": 0.21574372053146362,
      "pose_mae_dx": 0.047671541571617126,
      "pose_mae_dy": 0.07148544490337372,
      "pose_rmse_dtheta": 0.42987188696861267,
      "pose_rmse_dx": 0.12547346949577332,
      "pose_rmse_dy": 0.21733388304710388,
      "pose_rmse_mean": 0.25755974650382996,
      "rmse_dtheta": 0.04907640814781189,
      "rmse_dx": 0.01360680628567934,
      "rmse_dy": 0.011940781027078629,
      "rmse_mean": 0.024874668568372726,
      "rotation_flip": 0.01326259970664978,
      "sparse_tokens": 13734.0,
      "step": 9269,
      "turn_loss": 0.18117600679397583,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.430682029362572,
      "grad_norm": 0.7694752216339111,
      "learning_rate": 1.2482207500292532e-06,
      "loss": 0.2553,
      "mae_dtheta": 0.03352803364396095,
      "mae_dx": 0.01038074865937233,
      "mae_dy": 0.005251701921224594,
      "pose_mae_dtheta": 0.2386060506105423,
      "pose_mae_dx": 0.08476961404085159,
      "pose_mae_dy": 0.04646721109747887,
      "pose_rmse_dtheta": 0.4168188273906708,
      "pose_rmse_dx": 0.18230938911437988,
      "pose_rmse_dy": 0.10628034919500351,
      "pose_rmse_mean": 0.23513619601726532,
      "rmse_dtheta": 0.05145478621125221,
      "rmse_dx": 0.021271251142024994,
      "rmse_dy": 0.012326142750680447,
      "rmse_mean": 0.02835072949528694,
      "rotation_flip": 0.01725703850388527,
      "sparse_tokens": 18272.0,
      "step": 9270,
      "turn_loss": 0.28190353512763977,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.43072848912841477,
      "grad_norm": 0.5469383001327515,
      "learning_rate": 1.2473468492715896e-06,
      "loss": 0.1238,
      "mae_dtheta": 0.03201872110366821,
      "mae_dx": 0.011478572152554989,
      "mae_dy": 0.005105982534587383,
      "pose_mae_dtheta": 0.25551116466522217,
      "pose_mae_dx": 0.09178601950407028,
      "pose_mae_dy": 0.05450652539730072,
      "pose_rmse_dtheta": 0.4912457764148712,
      "pose_rmse_dx": 0.2130698561668396,
      "pose_rmse_dy": 0.15408237278461456,
      "pose_rmse_mean": 0.28613269329071045,
      "rmse_dtheta": 0.05212892219424248,
      "rmse_dx": 0.023565175011754036,
      "rmse_dy": 0.01251714676618576,
      "rmse_mean": 0.029403749853372574,
      "rotation_flip": 0.012509197928011417,
      "sparse_tokens": 22302.0,
      "step": 9271,
      "turn_loss": 0.26389551162719727,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.43077494889425755,
      "grad_norm": 0.43508684635162354,
      "learning_rate": 1.246473210938976e-06,
      "loss": 0.0861,
      "mae_dtheta": 0.005830209236592054,
      "mae_dx": 0.0010063728550449014,
      "mae_dy": 0.0008265438955277205,
      "pose_mae_dtheta": 0.04302816838026047,
      "pose_mae_dx": 0.010873707011342049,
      "pose_mae_dy": 0.0121579859405756,
      "pose_rmse_dtheta": 0.15776191651821136,
      "pose_rmse_dx": 0.026953112334012985,
      "pose_rmse_dy": 0.039006203413009644,
      "pose_rmse_mean": 0.07457374781370163,
      "rmse_dtheta": 0.018711084499955177,
      "rmse_dx": 0.00292925164103508,
      "rmse_dy": 0.001761942869052291,
      "rmse_mean": 0.007800759747624397,
      "rotation_flip": 0.0012442970182746649,
      "sparse_tokens": 32169.0,
      "step": 9272,
      "turn_loss": 0.040903110057115555,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.4308214086601004,
      "grad_norm": 0.7232792377471924,
      "learning_rate": 1.2455998350925042e-06,
      "loss": 0.1415,
      "mae_dtheta": 0.028888944536447525,
      "mae_dx": 0.009597388096153736,
      "mae_dy": 0.0040468135848641396,
      "pose_mae_dtheta": 0.21439093351364136,
      "pose_mae_dx": 0.06766866147518158,
      "pose_mae_dy": 0.06710311770439148,
      "pose_rmse_dtheta": 0.4108019471168518,
      "pose_rmse_dx": 0.16912618279457092,
      "pose_rmse_dy": 0.14623092114925385,
      "pose_rmse_mean": 0.24205303192138672,
      "rmse_dtheta": 0.04667947068810463,
      "rmse_dx": 0.0222865492105484,
      "rmse_dy": 0.007841568440198898,
      "rmse_mean": 0.02560253068804741,
      "rotation_flip": 0.016605166718363762,
      "sparse_tokens": 24161.0,
      "step": 9273,
      "turn_loss": 0.22787274420261383,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.43086786842594316,
      "grad_norm": 0.4470508098602295,
      "learning_rate": 1.2447267217932508e-06,
      "loss": 0.1788,
      "mae_dtheta": 0.00911693088710308,
      "mae_dx": 0.001267818734049797,
      "mae_dy": 0.002339091617614031,
      "pose_mae_dtheta": 0.05989084020256996,
      "pose_mae_dx": 0.015282473526895046,
      "pose_mae_dy": 0.021718766540288925,
      "pose_rmse_dtheta": 0.1713777482509613,
      "pose_rmse_dx": 0.038487471640110016,
      "pose_rmse_dy": 0.051236625760793686,
      "pose_rmse_mean": 0.0870339497923851,
      "rmse_dtheta": 0.022241689264774323,
      "rmse_dx": 0.003322046948596835,
      "rmse_dy": 0.005249900743365288,
      "rmse_mean": 0.010271212086081505,
      "rotation_flip": 0.002419354859739542,
      "sparse_tokens": 32089.0,
      "step": 9274,
      "turn_loss": 0.06900117546319962,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.43091432819178593,
      "grad_norm": 0.7314193248748779,
      "learning_rate": 1.2438538711022747e-06,
      "loss": 0.1461,
      "mae_dtheta": 0.012562155723571777,
      "mae_dx": 0.002076533157378435,
      "mae_dy": 0.0030316291376948357,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7314193248748779,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 163.55372619628906,
      "model/head/act_norm_mean": 104.27738320707071,
      "model/head/act_norm_min": 55.10246658325195,
      "model/head/act_over_embed": 71.6603940001418,
      "model/head/grad_frac": 0.1142117977142334,
      "model/head/grad_norm": 0.08353671431541443,
      "model/head/grad_zero_frac": 0.00011167966295033693,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7076231060606061,
      "model/head/update_ratio": 0.001422401051968336,
      "model/head/weight_delta": 9.89176082611084,
      "model/head/weight_delta_rel": 0.17353078722953796,
      "model/head/weight_norm": 58.729366302490234,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4226854741573334,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42261354591814393,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4225405156612396,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29042398532530217,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07241589576005936,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05296638607978821,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5407528727578476,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017102957936003804,
      "model/modality_embedder.encoders.pose/weight_delta": 3.137901782989502,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10252503305673599,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96913719177246,
      "model/modality_embedder/grad_frac": 0.07241589576005936,
      "model/modality_embedder/grad_norm": 0.05296638607978821,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5407528727578476,
      "model/modality_embedder/update_ratio": 0.0017102957936003804,
      "model/modality_embedder/weight_delta": 3.137901782989502,
      "model/modality_embedder/weight_delta_rel": 0.10252503305673599,
      "model/modality_embedder/weight_norm": 30.96913719177246,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.24369049072266,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.111707351290686,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.027331352233887,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.88258166702023,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.061188481748104095,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04475443810224533,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001601210911758244,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6929590702056885,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09813304990530014,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95037078857422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.35897064208984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.07793460397627,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.417252540588379,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.546582081027825,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06592371314764023,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04821787774562836,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016205826541408896,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.41433048248291,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11827507615089417,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.753421783447266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.17436218261719,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.92070757174924,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.250067710876465,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.812952916793748,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06771840900182724,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04953055456280708,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016121338121592999,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.6960134506225586,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12410520762205124,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.723600387573242,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.9957046508789,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.67834595959596,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.867825508117676,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.020818472191856,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06271358579397202,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04586992785334587,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015320172533392906,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.173201560974121,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10844497382640839,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.940868377685547,
      "model/normalizer/grad_frac": 0.22558806836605072,
      "model/normalizer/grad_norm": 0.16499947011470795,
      "model/normalizer/grad_zero_frac": 0.00018198772158939391,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020982050336897373,
      "model/normalizer/weight_delta": 6.681820869445801,
      "model/normalizer/weight_delta_rel": 0.08605798333883286,
      "model/normalizer/weight_norm": 78.63838958740234,
      "pose_mae_dtheta": 0.08592597395181656,
      "pose_mae_dx": 0.026238176971673965,
      "pose_mae_dy": 0.032609403133392334,
      "pose_rmse_dtheta": 0.22165808081626892,
      "pose_rmse_dx": 0.06681383401155472,
      "pose_rmse_dy": 0.06956957280635834,
      "pose_rmse_mean": 0.11934715509414673,
      "rmse_dtheta": 0.02643747627735138,
      "rmse_dx": 0.0060891686007380486,
      "rmse_dy": 0.006539661902934313,
      "rmse_mean": 0.013022102415561676,
      "rotation_flip": 0.004071058705449104,
      "sparse_tokens": 32105.0,
      "step": 9275,
      "turn_loss": 0.10717412829399109,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.4309607879576287,
      "grad_norm": 1.4102416038513184,
      "learning_rate": 1.2429812830806125e-06,
      "loss": 0.2566,
      "mae_dtheta": 0.028378065675497055,
      "mae_dx": 0.008936578407883644,
      "mae_dy": 0.005649348720908165,
      "pose_mae_dtheta": 0.20694325864315033,
      "pose_mae_dx": 0.073769211769104,
      "pose_mae_dy": 0.05157557874917984,
      "pose_rmse_dtheta": 0.40818026661872864,
      "pose_rmse_dx": 0.17002485692501068,
      "pose_rmse_dy": 0.15636767446994781,
      "pose_rmse_mean": 0.24485759437084198,
      "rmse_dtheta": 0.04776206985116005,
      "rmse_dx": 0.018931394442915916,
      "rmse_dy": 0.013106509111821651,
      "rmse_mean": 0.02659999206662178,
      "rotation_flip": 0.009074410423636436,
      "sparse_tokens": 9586.0,
      "step": 9276,
      "turn_loss": 0.23105090856552124,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.4310072477234715,
      "grad_norm": 1.2104108333587646,
      "learning_rate": 1.242108957789287e-06,
      "loss": 0.2157,
      "mae_dtheta": 0.03486403450369835,
      "mae_dx": 0.01203605905175209,
      "mae_dy": 0.003354331012815237,
      "pose_mae_dtheta": 0.25104260444641113,
      "pose_mae_dx": 0.08129756897687912,
      "pose_mae_dy": 0.04369254410266876,
      "pose_rmse_dtheta": 0.4064159393310547,
      "pose_rmse_dx": 0.17083317041397095,
      "pose_rmse_dy": 0.10838247835636139,
      "pose_rmse_mean": 0.22854386270046234,
      "rmse_dtheta": 0.0512382872402668,
      "rmse_dx": 0.023965593427419662,
      "rmse_dy": 0.006356856785714626,
      "rmse_mean": 0.027186913415789604,
      "rotation_flip": 0.018292682245373726,
      "sparse_tokens": 2933.0,
      "step": 9277,
      "turn_loss": 0.16728858649730682,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.43105370748931426,
      "grad_norm": 0.4608037769794464,
      "learning_rate": 1.241236895289299e-06,
      "loss": 0.1295,
      "mae_dtheta": 0.009611071087419987,
      "mae_dx": 0.0017759090987965465,
      "mae_dy": 0.0027336664497852325,
      "pose_mae_dtheta": 0.0590478740632534,
      "pose_mae_dx": 0.020242199301719666,
      "pose_mae_dy": 0.027569251134991646,
      "pose_rmse_dtheta": 0.1179395392537117,
      "pose_rmse_dx": 0.048886097967624664,
      "pose_rmse_dy": 0.0585758350789547,
      "pose_rmse_mean": 0.07513383030891418,
      "rmse_dtheta": 0.019403595477342606,
      "rmse_dx": 0.005058560520410538,
      "rmse_dy": 0.006853873375803232,
      "rmse_mean": 0.010438676923513412,
      "rotation_flip": 0.006139154080301523,
      "sparse_tokens": 32105.0,
      "step": 9278,
      "turn_loss": 0.10077480226755142,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22972.0,
      "epoch": 0.43110016725515704,
      "grad_norm": 0.8189763426780701,
      "learning_rate": 1.2403650956416308e-06,
      "loss": 0.1474,
      "mae_dtheta": 0.03069888986647129,
      "mae_dx": 0.00869570393115282,
      "mae_dy": 0.002604407025501132,
      "pose_mae_dtheta": 0.24310174584388733,
      "pose_mae_dx": 0.07141029089689255,
      "pose_mae_dy": 0.030140701681375504,
      "pose_rmse_dtheta": 0.45080065727233887,
      "pose_rmse_dx": 0.18232490122318268,
      "pose_rmse_dy": 0.08160097151994705,
      "pose_rmse_mean": 0.23824217915534973,
      "rmse_dtheta": 0.049267254769802094,
      "rmse_dx": 0.019980382174253464,
      "rmse_dy": 0.0054754046723246574,
      "rmse_mean": 0.024907678365707397,
      "rotation_flip": 0.010438413359224796,
      "sparse_tokens": 18915.0,
      "step": 9279,
      "turn_loss": 0.18508119881153107,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 39142.0,
      "epoch": 0.4311466270209998,
      "grad_norm": 0.6649080514907837,
      "learning_rate": 1.2394935589072505e-06,
      "loss": 0.1552,
      "mae_dtheta": 0.03010202758014202,
      "mae_dx": 0.011894683353602886,
      "mae_dy": 0.004392661154270172,
      "pose_mae_dtheta": 0.231122225522995,
      "pose_mae_dx": 0.09252765029668808,
      "pose_mae_dy": 0.04679691791534424,
      "pose_rmse_dtheta": 0.4368114471435547,
      "pose_rmse_dx": 0.21034908294677734,
      "pose_rmse_dy": 0.12786249816417694,
      "pose_rmse_mean": 0.2583410143852234,
      "rmse_dtheta": 0.04958028346300125,
      "rmse_dx": 0.02377071976661682,
      "rmse_dy": 0.009751921519637108,
      "rmse_mean": 0.02770097553730011,
      "rotation_flip": 0.014805675484240055,
      "sparse_tokens": 27999.0,
      "step": 9280,
      "turn_loss": 0.25178802013397217,
      "turns": 121.0,
      "turns_per_sample": 121.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.4311930867868426,
      "grad_norm": 0.5947244167327881,
      "learning_rate": 1.238622285147103e-06,
      "loss": 0.1469,
      "mae_dtheta": 0.04872063919901848,
      "mae_dx": 0.006025204434990883,
      "mae_dy": 0.0046910629607737064,
      "pose_mae_dtheta": 0.3770671784877777,
      "pose_mae_dx": 0.0670948326587677,
      "pose_mae_dy": 0.04789142310619354,
      "pose_rmse_dtheta": 0.641797661781311,
      "pose_rmse_dx": 0.12577098608016968,
      "pose_rmse_dy": 0.1089027151465416,
      "pose_rmse_mean": 0.2921571135520935,
      "rmse_dtheta": 0.07052729278802872,
      "rmse_dx": 0.0128204096108675,
      "rmse_dy": 0.009882302954792976,
      "rmse_mean": 0.031076667830348015,
      "rotation_flip": 0.027491409331560135,
      "sparse_tokens": 4487.0,
      "step": 9281,
      "turn_loss": 0.2180434614419937,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.43123954655268537,
      "grad_norm": 0.7022717595100403,
      "learning_rate": 1.2377512744221194e-06,
      "loss": 0.1181,
      "mae_dtheta": 0.019542574882507324,
      "mae_dx": 0.006356876343488693,
      "mae_dy": 0.006093516480177641,
      "pose_mae_dtheta": 0.1509149670600891,
      "pose_mae_dx": 0.03988904505968094,
      "pose_mae_dy": 0.04358428716659546,
      "pose_rmse_dtheta": 0.3561912477016449,
      "pose_rmse_dx": 0.0949455052614212,
      "pose_rmse_dy": 0.11473730951547623,
      "pose_rmse_mean": 0.18862470984458923,
      "rmse_dtheta": 0.04197569191455841,
      "rmse_dx": 0.017164792865514755,
      "rmse_dy": 0.015591851435601711,
      "rmse_mean": 0.024910777807235718,
      "rotation_flip": 0.013258897699415684,
      "sparse_tokens": 32217.0,
      "step": 9282,
      "turn_loss": 0.22175243496894836,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.43128600631852815,
      "grad_norm": 0.39990633726119995,
      "learning_rate": 1.2368805267932072e-06,
      "loss": 0.0913,
      "mae_dtheta": 0.011818521656095982,
      "mae_dx": 0.0018423479050397873,
      "mae_dy": 0.002976051764562726,
      "pose_mae_dtheta": 0.07605284452438354,
      "pose_mae_dx": 0.023520320653915405,
      "pose_mae_dy": 0.0311404038220644,
      "pose_rmse_dtheta": 0.16939035058021545,
      "pose_rmse_dx": 0.05891115963459015,
      "pose_rmse_dy": 0.07341853529214859,
      "pose_rmse_mean": 0.1005733534693718,
      "rmse_dtheta": 0.02362271025776863,
      "rmse_dx": 0.005558907985687256,
      "rmse_dy": 0.006730862893164158,
      "rmse_mean": 0.011970827355980873,
      "rotation_flip": 0.00374787044711411,
      "sparse_tokens": 32137.0,
      "step": 9283,
      "turn_loss": 0.0953013077378273,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.4313324660843709,
      "grad_norm": 0.5510135293006897,
      "learning_rate": 1.2360100423212607e-06,
      "loss": 0.1217,
      "mae_dtheta": 0.023923568427562714,
      "mae_dx": 0.007627533748745918,
      "mae_dy": 0.0032370765693485737,
      "pose_mae_dtheta": 0.19613593816757202,
      "pose_mae_dx": 0.05955994874238968,
      "pose_mae_dy": 0.05063634365797043,
      "pose_rmse_dtheta": 0.4250763952732086,
      "pose_rmse_dx": 0.15629085898399353,
      "pose_rmse_dy": 0.12133637815713882,
      "pose_rmse_mean": 0.23423455655574799,
      "rmse_dtheta": 0.04393749311566353,
      "rmse_dx": 0.01913199946284294,
      "rmse_dy": 0.006048287730664015,
      "rmse_mean": 0.023039259016513824,
      "rotation_flip": 0.008528784848749638,
      "sparse_tokens": 11307.0,
      "step": 9284,
      "turn_loss": 0.16150464117527008,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4313789258502137,
      "grad_norm": 0.563850998878479,
      "learning_rate": 1.2351398210671506e-06,
      "loss": 0.1022,
      "mae_dtheta": 0.009903548285365105,
      "mae_dx": 0.0016177936922758818,
      "mae_dy": 0.0021009990014135838,
      "pose_mae_dtheta": 0.07095981389284134,
      "pose_mae_dx": 0.015972353518009186,
      "pose_mae_dy": 0.02415136620402336,
      "pose_rmse_dtheta": 0.22066311538219452,
      "pose_rmse_dx": 0.043094392865896225,
      "pose_rmse_dy": 0.06378293037414551,
      "pose_rmse_mean": 0.10918014496564865,
      "rmse_dtheta": 0.024689950048923492,
      "rmse_dx": 0.00555475614964962,
      "rmse_dy": 0.005494848359376192,
      "rmse_mean": 0.011913185939192772,
      "rotation_flip": 0.0035425100941210985,
      "sparse_tokens": 32057.0,
      "step": 9285,
      "turn_loss": 0.07737130671739578,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4314253856160565,
      "grad_norm": 0.3478272259235382,
      "learning_rate": 1.2342698630917337e-06,
      "loss": 0.0791,
      "mae_dtheta": 0.009755251929163933,
      "mae_dx": 0.00155596190597862,
      "mae_dy": 0.002490753773599863,
      "pose_mae_dtheta": 0.06741269677877426,
      "pose_mae_dx": 0.02038031816482544,
      "pose_mae_dy": 0.026280591264367104,
      "pose_rmse_dtheta": 0.18269860744476318,
      "pose_rmse_dx": 0.052863433957099915,
      "pose_rmse_dy": 0.053983092308044434,
      "pose_rmse_mean": 0.09651504456996918,
      "rmse_dtheta": 0.021549798548221588,
      "rmse_dx": 0.00421065092086792,
      "rmse_dy": 0.005214788485318422,
      "rmse_mean": 0.010325079783797264,
      "rotation_flip": 0.004314994439482689,
      "sparse_tokens": 32121.0,
      "step": 9286,
      "turn_loss": 0.0765962153673172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.43147184538189925,
      "grad_norm": 0.32679304480552673,
      "learning_rate": 1.2334001684558482e-06,
      "loss": 0.0752,
      "mae_dtheta": 0.01308545283973217,
      "mae_dx": 0.0016233435599133372,
      "mae_dy": 0.002937400946393609,
      "pose_mae_dtheta": 0.08981728553771973,
      "pose_mae_dx": 0.02262641116976738,
      "pose_mae_dy": 0.03471038490533829,
      "pose_rmse_dtheta": 0.22966478765010834,
      "pose_rmse_dx": 0.05796787887811661,
      "pose_rmse_dy": 0.07710601389408112,
      "pose_rmse_mean": 0.12157957255840302,
      "rmse_dtheta": 0.026381900534033775,
      "rmse_dx": 0.0056189484894275665,
      "rmse_dy": 0.006730688735842705,
      "rmse_mean": 0.012910513207316399,
      "rotation_flip": 0.009621992707252502,
      "sparse_tokens": 32057.0,
      "step": 9287,
      "turn_loss": 0.09686125814914703,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5223.0,
      "epoch": 0.43151830514774203,
      "grad_norm": 0.8547402620315552,
      "learning_rate": 1.2325307372203093e-06,
      "loss": 0.2778,
      "mae_dtheta": 0.03833289071917534,
      "mae_dx": 0.01710228994488716,
      "mae_dy": 0.006684760097414255,
      "pose_mae_dtheta": 0.34320592880249023,
      "pose_mae_dx": 0.12127921730279922,
      "pose_mae_dy": 0.09356539696455002,
      "pose_rmse_dtheta": 0.5315541625022888,
      "pose_rmse_dx": 0.2581467628479004,
      "pose_rmse_dy": 0.19611471891403198,
      "pose_rmse_mean": 0.3286052346229553,
      "rmse_dtheta": 0.0533890426158905,
      "rmse_dx": 0.03169138357043266,
      "rmse_dy": 0.011989662423729897,
      "rmse_mean": 0.03235669806599617,
      "rotation_flip": 0.02641509473323822,
      "sparse_tokens": 4069.0,
      "step": 9288,
      "turn_loss": 0.37739232182502747,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.4315647649135848,
      "grad_norm": 0.7363865375518799,
      "learning_rate": 1.2316615694459188e-06,
      "loss": 0.189,
      "mae_dtheta": 0.030979279428720474,
      "mae_dx": 0.010706343688070774,
      "mae_dy": 0.005503101274371147,
      "pose_mae_dtheta": 0.22408339381217957,
      "pose_mae_dx": 0.08301083743572235,
      "pose_mae_dy": 0.05478108301758766,
      "pose_rmse_dtheta": 0.3925556540489197,
      "pose_rmse_dx": 0.18146027624607086,
      "pose_rmse_dy": 0.12041079252958298,
      "pose_rmse_mean": 0.2314755767583847,
      "rmse_dtheta": 0.04830655828118324,
      "rmse_dx": 0.021762264892458916,
      "rmse_dy": 0.011617068201303482,
      "rmse_mean": 0.02722862921655178,
      "rotation_flip": 0.011413520202040672,
      "sparse_tokens": 18321.0,
      "step": 9289,
      "turn_loss": 0.28616124391555786,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.43161122467942764,
      "grad_norm": 0.5833091735839844,
      "learning_rate": 1.2307926651934565e-06,
      "loss": 0.0947,
      "mae_dtheta": 0.0066716792061924934,
      "mae_dx": 0.0008667637011967599,
      "mae_dy": 0.001249186578206718,
      "pose_mae_dtheta": 0.04421769455075264,
      "pose_mae_dx": 0.011292768642306328,
      "pose_mae_dy": 0.01943788304924965,
      "pose_rmse_dtheta": 0.09447257965803146,
      "pose_rmse_dx": 0.0331338495016098,
      "pose_rmse_dy": 0.047626979649066925,
      "pose_rmse_mean": 0.0584111325442791,
      "rmse_dtheta": 0.015440232120454311,
      "rmse_dx": 0.0027095391415059566,
      "rmse_dy": 0.0029690454248338938,
      "rmse_mean": 0.007039605639874935,
      "rotation_flip": 0.0019286402966827154,
      "sparse_tokens": 32073.0,
      "step": 9290,
      "turn_loss": 0.045765846967697144,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.4316576844452704,
      "grad_norm": 0.45184460282325745,
      "learning_rate": 1.2299240245236876e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.04296785593032837,
      "mae_dx": 0.014756489545106888,
      "mae_dy": 0.0030083435121923685,
      "pose_mae_dtheta": 0.3810584545135498,
      "pose_mae_dx": 0.12774494290351868,
      "pose_mae_dy": 0.04972264543175697,
      "pose_rmse_dtheta": 0.6594098806381226,
      "pose_rmse_dx": 0.3059731721878052,
      "pose_rmse_dy": 0.1058378666639328,
      "pose_rmse_mean": 0.3570736348628998,
      "rmse_dtheta": 0.063813716173172,
      "rmse_dx": 0.030316196382045746,
      "rmse_dy": 0.006143413484096527,
      "rmse_mean": 0.03342444449663162,
      "rotation_flip": 0.0055555556900799274,
      "sparse_tokens": 6590.0,
      "step": 9291,
      "turn_loss": 0.22496774792671204,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.4317041442111132,
      "grad_norm": 0.7114769220352173,
      "learning_rate": 1.2290556474973536e-06,
      "loss": 0.1855,
      "mae_dtheta": 0.019989745691418648,
      "mae_dx": 0.00768671277910471,
      "mae_dy": 0.003264147322624922,
      "pose_mae_dtheta": 0.13375432789325714,
      "pose_mae_dx": 0.05539241060614586,
      "pose_mae_dy": 0.05252419039607048,
      "pose_rmse_dtheta": 0.34593072533607483,
      "pose_rmse_dx": 0.19176799058914185,
      "pose_rmse_dy": 0.1493072658777237,
      "pose_rmse_mean": 0.2290019989013672,
      "rmse_dtheta": 0.04101819917559624,
      "rmse_dx": 0.021708792075514793,
      "rmse_dy": 0.007434018887579441,
      "rmse_mean": 0.02338700369000435,
      "rotation_flip": 0.007547169923782349,
      "sparse_tokens": 7469.0,
      "step": 9292,
      "turn_loss": 0.1432742029428482,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.43175060397695597,
      "grad_norm": 0.4035317599773407,
      "learning_rate": 1.228187534175182e-06,
      "loss": 0.0722,
      "mae_dtheta": 0.04742426425218582,
      "mae_dx": 0.016632862389087677,
      "mae_dy": 0.0017135669477283955,
      "pose_mae_dtheta": 0.41778549551963806,
      "pose_mae_dx": 0.18080927431583405,
      "pose_mae_dy": 0.0371326208114624,
      "pose_rmse_dtheta": 0.6782532334327698,
      "pose_rmse_dx": 0.34997764229774475,
      "pose_rmse_dy": 0.09148134291172028,
      "pose_rmse_mean": 0.3732374310493469,
      "rmse_dtheta": 0.06952803581953049,
      "rmse_dx": 0.030226439237594604,
      "rmse_dy": 0.003768045222386718,
      "rmse_mean": 0.03450750559568405,
      "rotation_flip": 0.020202020183205605,
      "sparse_tokens": 3825.0,
      "step": 9293,
      "turn_loss": 0.18888208270072937,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.43179706374279875,
      "grad_norm": 0.4470806419849396,
      "learning_rate": 1.227319684617882e-06,
      "loss": 0.0897,
      "mae_dtheta": 0.006594982463866472,
      "mae_dx": 0.0013461689231917262,
      "mae_dy": 0.001569909742102027,
      "pose_mae_dtheta": 0.04196719080209732,
      "pose_mae_dx": 0.01639651320874691,
      "pose_mae_dy": 0.015880806371569633,
      "pose_rmse_dtheta": 0.0966757982969284,
      "pose_rmse_dx": 0.0416572280228138,
      "pose_rmse_dy": 0.04280073568224907,
      "pose_rmse_mean": 0.06037792190909386,
      "rmse_dtheta": 0.01684204861521721,
      "rmse_dx": 0.0035569474566727877,
      "rmse_dy": 0.004227408207952976,
      "rmse_mean": 0.008208801969885826,
      "rotation_flip": 0.002260738518089056,
      "sparse_tokens": 32201.0,
      "step": 9294,
      "turn_loss": 0.05459985509514809,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4318435235086415,
      "grad_norm": 0.556843638420105,
      "learning_rate": 1.22645209888614e-06,
      "loss": 0.1212,
      "mae_dtheta": 0.011442359536886215,
      "mae_dx": 0.0014460704987868667,
      "mae_dy": 0.0025682407431304455,
      "pose_mae_dtheta": 0.06911113858222961,
      "pose_mae_dx": 0.023315168917179108,
      "pose_mae_dy": 0.032066818326711655,
      "pose_rmse_dtheta": 0.14752952754497528,
      "pose_rmse_dx": 0.06236051768064499,
      "pose_rmse_dy": 0.06688670814037323,
      "pose_rmse_mean": 0.09225891530513763,
      "rmse_dtheta": 0.023105530068278313,
      "rmse_dx": 0.004495012108236551,
      "rmse_dy": 0.005986595991998911,
      "rmse_mean": 0.0111957136541605,
      "rotation_flip": 0.0018089724471792579,
      "sparse_tokens": 32089.0,
      "step": 9295,
      "turn_loss": 0.09578943997621536,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4318899832744843,
      "grad_norm": 0.6789968609809875,
      "learning_rate": 1.2255847770406297e-06,
      "loss": 0.1677,
      "mae_dtheta": 0.008401473052799702,
      "mae_dx": 0.0014873939799144864,
      "mae_dy": 0.0015031209914013743,
      "pose_mae_dtheta": 0.05875306949019432,
      "pose_mae_dx": 0.012501533143222332,
      "pose_mae_dy": 0.015085271559655666,
      "pose_rmse_dtheta": 0.21595443785190582,
      "pose_rmse_dx": 0.03975197300314903,
      "pose_rmse_dy": 0.0375802256166935,
      "pose_rmse_mean": 0.09776221215724945,
      "rmse_dtheta": 0.0240616537630558,
      "rmse_dx": 0.00598440645262599,
      "rmse_dy": 0.0058656055480241776,
      "rmse_mean": 0.011970555409789085,
      "rotation_flip": 0.007881316356360912,
      "sparse_tokens": 32105.0,
      "step": 9296,
      "turn_loss": 0.0653320923447609,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2309.0,
      "epoch": 0.4319364430403271,
      "grad_norm": 0.6980642080307007,
      "learning_rate": 1.224717719142e-06,
      "loss": 0.1677,
      "mae_dtheta": 0.025424093008041382,
      "mae_dx": 0.01566920056939125,
      "mae_dy": 0.00609687902033329,
      "pose_mae_dtheta": 0.13440552353858948,
      "pose_mae_dx": 0.0752350464463234,
      "pose_mae_dy": 0.07669087499380112,
      "pose_rmse_dtheta": 0.19164420664310455,
      "pose_rmse_dx": 0.17866574227809906,
      "pose_rmse_dy": 0.15802980959415436,
      "pose_rmse_mean": 0.17611324787139893,
      "rmse_dtheta": 0.037861417979002,
      "rmse_dx": 0.029084699228405952,
      "rmse_dy": 0.010286564007401466,
      "rmse_mean": 0.025744227692484856,
      "rotation_flip": 0.007936508394777775,
      "sparse_tokens": 2000.0,
      "step": 9297,
      "turn_loss": 0.34872785210609436,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.43198290280616986,
      "grad_norm": 0.4463158845901489,
      "learning_rate": 1.2238509252508884e-06,
      "loss": 0.1314,
      "mae_dtheta": 0.01297441590577364,
      "mae_dx": 0.0029923219699412584,
      "mae_dy": 0.00400604959577322,
      "pose_mae_dtheta": 0.08656133711338043,
      "pose_mae_dx": 0.034116342663764954,
      "pose_mae_dy": 0.040295593440532684,
      "pose_rmse_dtheta": 0.16300223767757416,
      "pose_rmse_dx": 0.08056098222732544,
      "pose_rmse_dy": 0.08767083287239075,
      "pose_rmse_mean": 0.11041134595870972,
      "rmse_dtheta": 0.022946281358599663,
      "rmse_dx": 0.00824571494013071,
      "rmse_dy": 0.008230364881455898,
      "rmse_mean": 0.013140788301825523,
      "rotation_flip": 0.009875640273094177,
      "sparse_tokens": 32073.0,
      "step": 9298,
      "turn_loss": 0.13870342075824738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.43202936257201263,
      "grad_norm": 0.30966717004776,
      "learning_rate": 1.2229843954279069e-06,
      "loss": 0.0658,
      "mae_dtheta": 0.007984460331499577,
      "mae_dx": 0.0013239271938800812,
      "mae_dy": 0.0014332563150674105,
      "pose_mae_dtheta": 0.05901407077908516,
      "pose_mae_dx": 0.01756972447037697,
      "pose_mae_dy": 0.02142353542149067,
      "pose_rmse_dtheta": 0.1771399825811386,
      "pose_rmse_dx": 0.05177963152527809,
      "pose_rmse_dy": 0.05649745091795921,
      "pose_rmse_mean": 0.0951390191912651,
      "rmse_dtheta": 0.02067861706018448,
      "rmse_dx": 0.004990920424461365,
      "rmse_dy": 0.003345081117004156,
      "rmse_mean": 0.00967153999954462,
      "rotation_flip": 0.0016447368543595076,
      "sparse_tokens": 32057.0,
      "step": 9299,
      "turn_loss": 0.05875532701611519,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4320758223378554,
      "grad_norm": 0.3899896740913391,
      "learning_rate": 1.2221181297336537e-06,
      "loss": 0.0703,
      "mae_dtheta": 0.00562750268727541,
      "mae_dx": 0.000880748382769525,
      "mae_dy": 0.0009633006411604583,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3899897038936615,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.66693115234375,
      "model/head/act_norm_mean": 118.52000473484848,
      "model/head/act_norm_min": 67.51709747314453,
      "model/head/act_over_embed": 81.44805685555427,
      "model/head/grad_frac": 0.09286324679851532,
      "model/head/grad_norm": 0.03621571138501167,
      "model/head/grad_zero_frac": 0.00017703764024190605,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7036428740530303,
      "model/head/update_ratio": 0.0006166507373563945,
      "model/head/weight_delta": 9.894935607910156,
      "model/head/weight_delta_rel": 0.17358647286891937,
      "model/head/weight_norm": 58.729698181152344,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4227239191532135,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42265545008991257,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42257946729660034,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29045278226445465,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12822705507278442,
      "model/modality_embedder.encoders.pose/grad_norm": 0.050007231533527374,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.545438119493392,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016147419810295105,
      "model/modality_embedder.encoders.pose/weight_delta": 3.139033079147339,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10256199538707733,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96917724609375,
      "model/modality_embedder/grad_frac": 0.12822705507278442,
      "model/modality_embedder/grad_norm": 0.050007231533527374,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.545438119493392,
      "model/modality_embedder/update_ratio": 0.0016147419810295105,
      "model/modality_embedder/weight_delta": 3.139033079147339,
      "model/modality_embedder/weight_delta_rel": 0.10256199538707733,
      "model/modality_embedder/weight_norm": 30.96917724609375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.28043365478516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.470320767195766,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.06817626953125,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.8162335259694,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.060516856610774994,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.023600950837135315,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008443791884928942,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6944375038146973,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0981869250535965,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.950654983520508,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.78874206542969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.498594576719576,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.375771522521973,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.52287291472524,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.058680806308984756,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0228849109262228,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0003379196277819574,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007691375794820487,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.416189670562744,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11833947896957397,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.75398826599121,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.58570861816406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.309879549462885,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.587645530700684,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.767604905511526,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.056080423295497894,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02187078818678856,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000711845001205802,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.698073387145996,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12417437881231308,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.72408676147461,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.28352355957031,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.96839175485009,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.311979293823242,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.907350020289517,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05411750450730324,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.021105268970131874,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007048890111036599,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1750974655151367,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10850976407527924,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.941265106201172,
      "model/normalizer/grad_frac": 0.1930629014968872,
      "model/normalizer/grad_norm": 0.07529254257678986,
      "model/normalizer/grad_zero_frac": 0.00028598069911822677,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0009574469295330346,
      "model/normalizer/weight_delta": 6.685508728027344,
      "model/normalizer/weight_delta_rel": 0.08610548079013824,
      "model/normalizer/weight_norm": 78.63887023925781,
      "pose_mae_dtheta": 0.03615611419081688,
      "pose_mae_dx": 0.010919219814240932,
      "pose_mae_dy": 0.014626902528107166,
      "pose_rmse_dtheta": 0.11721388250589371,
      "pose_rmse_dx": 0.026132788509130478,
      "pose_rmse_dy": 0.035960640758275986,
      "pose_rmse_mean": 0.05976910516619682,
      "rmse_dtheta": 0.016546867787837982,
      "rmse_dx": 0.002536830259487033,
      "rmse_dy": 0.002193381078541279,
      "rmse_mean": 0.007092359475791454,
      "rotation_flip": 0.00044702726881951094,
      "sparse_tokens": 32137.0,
      "step": 9300,
      "turn_loss": 0.04130207374691963,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.4321222821036982,
      "grad_norm": 0.5471495985984802,
      "learning_rate": 1.2212521282287093e-06,
      "loss": 0.0971,
      "mae_dtheta": 0.03713458776473999,
      "mae_dx": 0.01026416290551424,
      "mae_dy": 0.002744305646046996,
      "pose_mae_dtheta": 0.28155091404914856,
      "pose_mae_dx": 0.08885132521390915,
      "pose_mae_dy": 0.05535973235964775,
      "pose_rmse_dtheta": 0.5249109268188477,
      "pose_rmse_dx": 0.21316491067409515,
      "pose_rmse_dy": 0.13188360631465912,
      "pose_rmse_mean": 0.2899864912033081,
      "rmse_dtheta": 0.056231554597616196,
      "rmse_dx": 0.022295676171779633,
      "rmse_dy": 0.005332705564796925,
      "rmse_mean": 0.027953311800956726,
      "rotation_flip": 0.014117646962404251,
      "sparse_tokens": 5946.0,
      "step": 9301,
      "turn_loss": 0.26619720458984375,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.43216874186954096,
      "grad_norm": 0.4594517946243286,
      "learning_rate": 1.2203863909736296e-06,
      "loss": 0.0929,
      "mae_dtheta": 0.011421607807278633,
      "mae_dx": 0.001781134749762714,
      "mae_dy": 0.0024916324764490128,
      "pose_mae_dtheta": 0.08007204532623291,
      "pose_mae_dx": 0.020875342190265656,
      "pose_mae_dy": 0.02564096637070179,
      "pose_rmse_dtheta": 0.17555253207683563,
      "pose_rmse_dx": 0.05400465056300163,
      "pose_rmse_dy": 0.056856919080019,
      "pose_rmse_mean": 0.09547137469053268,
      "rmse_dtheta": 0.022572066634893417,
      "rmse_dx": 0.005507147405296564,
      "rmse_dy": 0.005477411672472954,
      "rmse_mean": 0.01118554174900055,
      "rotation_flip": 0.006280530244112015,
      "sparse_tokens": 32105.0,
      "step": 9302,
      "turn_loss": 0.08937808126211166,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.43221520163538374,
      "grad_norm": 0.7047373056411743,
      "learning_rate": 1.2195209180289603e-06,
      "loss": 0.2023,
      "mae_dtheta": 0.009565564803779125,
      "mae_dx": 0.0016216584481298923,
      "mae_dy": 0.0022470576222985983,
      "pose_mae_dtheta": 0.06368657201528549,
      "pose_mae_dx": 0.015739386901259422,
      "pose_mae_dy": 0.028076283633708954,
      "pose_rmse_dtheta": 0.15164031088352203,
      "pose_rmse_dx": 0.04050653427839279,
      "pose_rmse_dy": 0.07282410562038422,
      "pose_rmse_mean": 0.08832365274429321,
      "rmse_dtheta": 0.019851109012961388,
      "rmse_dx": 0.00543324975296855,
      "rmse_dy": 0.005434081424027681,
      "rmse_mean": 0.010239480063319206,
      "rotation_flip": 0.006162273231893778,
      "sparse_tokens": 32121.0,
      "step": 9303,
      "turn_loss": 0.07980871200561523,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4322616614012265,
      "grad_norm": 0.3990846276283264,
      "learning_rate": 1.2186557094552203e-06,
      "loss": 0.1095,
      "mae_dtheta": 0.00916297361254692,
      "mae_dx": 0.0024515597615391016,
      "mae_dy": 0.002296655671671033,
      "pose_mae_dtheta": 0.06078391894698143,
      "pose_mae_dx": 0.027582349255681038,
      "pose_mae_dy": 0.029245266690850258,
      "pose_rmse_dtheta": 0.14690712094306946,
      "pose_rmse_dx": 0.08150646090507507,
      "pose_rmse_dy": 0.08357113599777222,
      "pose_rmse_mean": 0.10399490594863892,
      "rmse_dtheta": 0.020927656441926956,
      "rmse_dx": 0.008683441206812859,
      "rmse_dy": 0.005365522112697363,
      "rmse_mean": 0.011658873409032822,
      "rotation_flip": 0.004710920620709658,
      "sparse_tokens": 32089.0,
      "step": 9304,
      "turn_loss": 0.10506375879049301,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4323081211670693,
      "grad_norm": 0.4014357626438141,
      "learning_rate": 1.2177907653129178e-06,
      "loss": 0.1271,
      "mae_dtheta": 0.009773270227015018,
      "mae_dx": 0.002585221314802766,
      "mae_dy": 0.0021163364872336388,
      "pose_mae_dtheta": 0.059651050716638565,
      "pose_mae_dx": 0.028882743790745735,
      "pose_mae_dy": 0.028642943128943443,
      "pose_rmse_dtheta": 0.13740745186805725,
      "pose_rmse_dx": 0.08422155678272247,
      "pose_rmse_dy": 0.06558125466108322,
      "pose_rmse_mean": 0.09573675692081451,
      "rmse_dtheta": 0.020517315715551376,
      "rmse_dx": 0.008757451549172401,
      "rmse_dy": 0.004152566194534302,
      "rmse_mean": 0.011142445728182793,
      "rotation_flip": 0.006050826981663704,
      "sparse_tokens": 32073.0,
      "step": 9305,
      "turn_loss": 0.11553120613098145,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.4323545809329121,
      "grad_norm": 0.7395910620689392,
      "learning_rate": 1.2169260856625358e-06,
      "loss": 0.1755,
      "mae_dtheta": 0.04802808165550232,
      "mae_dx": 0.018277384340763092,
      "mae_dy": 0.007710742298513651,
      "pose_mae_dtheta": 0.40042975544929504,
      "pose_mae_dx": 0.14321987330913544,
      "pose_mae_dy": 0.0764390379190445,
      "pose_rmse_dtheta": 0.6575325131416321,
      "pose_rmse_dx": 0.291495680809021,
      "pose_rmse_dy": 0.14801384508609772,
      "pose_rmse_mean": 0.3656806945800781,
      "rmse_dtheta": 0.06563281267881393,
      "rmse_dx": 0.032899368554353714,
      "rmse_dy": 0.013674546033143997,
      "rmse_mean": 0.03740224242210388,
      "rotation_flip": 0.014598540030419827,
      "sparse_tokens": 10799.0,
      "step": 9306,
      "turn_loss": 0.2982182502746582,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.4324010406987549,
      "grad_norm": 0.43841129541397095,
      "learning_rate": 1.2160616705645434e-06,
      "loss": 0.0857,
      "mae_dtheta": 0.038277916610240936,
      "mae_dx": 0.008246649987995625,
      "mae_dy": 0.007250271737575531,
      "pose_mae_dtheta": 0.3102433383464813,
      "pose_mae_dx": 0.07018722593784332,
      "pose_mae_dy": 0.10753625631332397,
      "pose_rmse_dtheta": 0.501387357711792,
      "pose_rmse_dx": 0.14053113758563995,
      "pose_rmse_dy": 0.19972549378871918,
      "pose_rmse_mean": 0.28054800629615784,
      "rmse_dtheta": 0.05141487345099449,
      "rmse_dx": 0.019727498292922974,
      "rmse_dy": 0.010566594079136848,
      "rmse_mean": 0.027236323803663254,
      "rotation_flip": 0.022900763899087906,
      "sparse_tokens": 4607.0,
      "step": 9307,
      "turn_loss": 0.34503233432769775,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.4324475004645977,
      "grad_norm": 0.44651591777801514,
      "learning_rate": 1.2151975200793902e-06,
      "loss": 0.1374,
      "mae_dtheta": 0.031080689281225204,
      "mae_dx": 0.0037168082781136036,
      "mae_dy": 0.0025489453691989183,
      "pose_mae_dtheta": 0.1972178816795349,
      "pose_mae_dx": 0.026294302195310593,
      "pose_mae_dy": 0.035767167806625366,
      "pose_rmse_dtheta": 0.4011722505092621,
      "pose_rmse_dx": 0.05504635348916054,
      "pose_rmse_dy": 0.13093769550323486,
      "pose_rmse_mean": 0.19571876525878906,
      "rmse_dtheta": 0.05300739035010338,
      "rmse_dx": 0.008925775066018105,
      "rmse_dy": 0.007640701252967119,
      "rmse_mean": 0.023191291838884354,
      "rotation_flip": 0.005263158120214939,
      "sparse_tokens": 6540.0,
      "step": 9308,
      "turn_loss": 0.2178153544664383,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.43249396023044046,
      "grad_norm": 0.5403192043304443,
      "learning_rate": 1.2143336342675044e-06,
      "loss": 0.1703,
      "mae_dtheta": 0.03793182224035263,
      "mae_dx": 0.013577443547546864,
      "mae_dy": 0.004923385567963123,
      "pose_mae_dtheta": 0.2917211353778839,
      "pose_mae_dx": 0.12432817369699478,
      "pose_mae_dy": 0.07725844532251358,
      "pose_rmse_dtheta": 0.5130283236503601,
      "pose_rmse_dx": 0.26643556356430054,
      "pose_rmse_dy": 0.17727890610694885,
      "pose_rmse_mean": 0.3189142644405365,
      "rmse_dtheta": 0.05625723674893379,
      "rmse_dx": 0.02720368281006813,
      "rmse_dy": 0.009326821193099022,
      "rmse_mean": 0.03092924878001213,
      "rotation_flip": 0.014767932705581188,
      "sparse_tokens": 16009.0,
      "step": 9309,
      "turn_loss": 0.2871735990047455,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 34713.0,
      "epoch": 0.43254041999628323,
      "grad_norm": 0.5240627527236938,
      "learning_rate": 1.2134700131893013e-06,
      "loss": 0.1585,
      "mae_dtheta": 0.027947386726737022,
      "mae_dx": 0.010503893718123436,
      "mae_dy": 0.004963913466781378,
      "pose_mae_dtheta": 0.1950037181377411,
      "pose_mae_dx": 0.09254473447799683,
      "pose_mae_dy": 0.054281286895275116,
      "pose_rmse_dtheta": 0.33094626665115356,
      "pose_rmse_dx": 0.2155524045228958,
      "pose_rmse_dy": 0.1334657073020935,
      "pose_rmse_mean": 0.2266547977924347,
      "rmse_dtheta": 0.042503323405981064,
      "rmse_dx": 0.023013485595583916,
      "rmse_dy": 0.010078874416649342,
      "rmse_mean": 0.02519856207072735,
      "rotation_flip": 0.010948904789984226,
      "sparse_tokens": 28644.0,
      "step": 9310,
      "turn_loss": 0.2565377950668335,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.432586879762126,
      "grad_norm": 0.48597660660743713,
      "learning_rate": 1.2126066569051708e-06,
      "loss": 0.11,
      "mae_dtheta": 0.01814066804945469,
      "mae_dx": 0.005131203681230545,
      "mae_dy": 0.0030008761677891016,
      "pose_mae_dtheta": 0.14570951461791992,
      "pose_mae_dx": 0.04617057368159294,
      "pose_mae_dy": 0.05726982280611992,
      "pose_rmse_dtheta": 0.2824576199054718,
      "pose_rmse_dx": 0.11735669523477554,
      "pose_rmse_dy": 0.11406086385250092,
      "pose_rmse_mean": 0.17129173874855042,
      "rmse_dtheta": 0.032253555953502655,
      "rmse_dx": 0.01454007625579834,
      "rmse_dy": 0.005182391032576561,
      "rmse_mean": 0.01732534170150757,
      "rotation_flip": 0.014260249212384224,
      "sparse_tokens": 12032.0,
      "step": 9311,
      "turn_loss": 0.15486399829387665,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.4326333395279688,
      "grad_norm": 0.5701401233673096,
      "learning_rate": 1.21174356547549e-06,
      "loss": 0.0957,
      "mae_dtheta": 0.030323712155222893,
      "mae_dx": 0.013673224486410618,
      "mae_dy": 0.00538927037268877,
      "pose_mae_dtheta": 0.2275809794664383,
      "pose_mae_dx": 0.11080358177423477,
      "pose_mae_dy": 0.04446029290556908,
      "pose_rmse_dtheta": 0.37010449171066284,
      "pose_rmse_dx": 0.23762373626232147,
      "pose_rmse_dy": 0.07756348699331284,
      "pose_rmse_mean": 0.22843056917190552,
      "rmse_dtheta": 0.045245956629514694,
      "rmse_dx": 0.0265860203653574,
      "rmse_dy": 0.009500664658844471,
      "rmse_mean": 0.027110882103443146,
      "rotation_flip": 0.013100436888635159,
      "sparse_tokens": 4303.0,
      "step": 9312,
      "turn_loss": 0.3003540635108948,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.43267979929381156,
      "grad_norm": 0.7355135679244995,
      "learning_rate": 1.210880738960616e-06,
      "loss": 0.1112,
      "mae_dtheta": 0.006974231451749802,
      "mae_dx": 0.001541842706501484,
      "mae_dy": 0.0005751177668571472,
      "pose_mae_dtheta": 0.05106556788086891,
      "pose_mae_dx": 0.013346020132303238,
      "pose_mae_dy": 0.007140656467527151,
      "pose_rmse_dtheta": 0.2036042958498001,
      "pose_rmse_dx": 0.029741372913122177,
      "pose_rmse_dy": 0.023783927783370018,
      "pose_rmse_mean": 0.08570986986160278,
      "rmse_dtheta": 0.023606449365615845,
      "rmse_dx": 0.004583796486258507,
      "rmse_dy": 0.0016859390307217836,
      "rmse_mean": 0.009958729147911072,
      "rotation_flip": 0.001788908732123673,
      "sparse_tokens": 32233.0,
      "step": 9313,
      "turn_loss": 0.05007737874984741,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.43272625905965434,
      "grad_norm": 0.393962562084198,
      "learning_rate": 1.2100181774208841e-06,
      "loss": 0.0696,
      "mae_dtheta": 0.013055721297860146,
      "mae_dx": 0.0016835470451042056,
      "mae_dy": 0.0031190200243145227,
      "pose_mae_dtheta": 0.08561062812805176,
      "pose_mae_dx": 0.027441993355751038,
      "pose_mae_dy": 0.03747718781232834,
      "pose_rmse_dtheta": 0.19500821828842163,
      "pose_rmse_dx": 0.06764309108257294,
      "pose_rmse_dy": 0.08739157021045685,
      "pose_rmse_mean": 0.11668096482753754,
      "rmse_dtheta": 0.024970708414912224,
      "rmse_dx": 0.004401450045406818,
      "rmse_dy": 0.006171888206154108,
      "rmse_mean": 0.011848016642034054,
      "rotation_flip": 0.005466238129884005,
      "sparse_tokens": 32105.0,
      "step": 9314,
      "turn_loss": 0.08941378444433212,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4327727188254971,
      "grad_norm": 0.33121272921562195,
      "learning_rate": 1.209155880916617e-06,
      "loss": 0.0725,
      "mae_dtheta": 0.009970027022063732,
      "mae_dx": 0.0013821945758536458,
      "mae_dy": 0.0024524417240172625,
      "pose_mae_dtheta": 0.06337081640958786,
      "pose_mae_dx": 0.02234005182981491,
      "pose_mae_dy": 0.029763296246528625,
      "pose_rmse_dtheta": 0.14893405139446259,
      "pose_rmse_dx": 0.05764776095747948,
      "pose_rmse_dy": 0.07823368906974792,
      "pose_rmse_mean": 0.0949385017156601,
      "rmse_dtheta": 0.02118760533630848,
      "rmse_dx": 0.0034611260052770376,
      "rmse_dy": 0.005246482789516449,
      "rmse_mean": 0.009965071454644203,
      "rotation_flip": 0.0027921819128096104,
      "sparse_tokens": 32105.0,
      "step": 9315,
      "turn_loss": 0.07310009747743607,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4328191785913399,
      "grad_norm": 0.4918421804904938,
      "learning_rate": 1.2082938495081143e-06,
      "loss": 0.0733,
      "mae_dtheta": 0.0057740951888263226,
      "mae_dx": 0.0011437754146754742,
      "mae_dy": 0.0007844956708140671,
      "pose_mae_dtheta": 0.040684737265110016,
      "pose_mae_dx": 0.00994329433888197,
      "pose_mae_dy": 0.011756911873817444,
      "pose_rmse_dtheta": 0.14517748355865479,
      "pose_rmse_dx": 0.023512711748480797,
      "pose_rmse_dy": 0.028507348150014877,
      "pose_rmse_mean": 0.06573251634836197,
      "rmse_dtheta": 0.018063126131892204,
      "rmse_dx": 0.0033936493564397097,
      "rmse_dy": 0.0015345725696533918,
      "rmse_mean": 0.007663782685995102,
      "rotation_flip": 0.0020682523027062416,
      "sparse_tokens": 32169.0,
      "step": 9316,
      "turn_loss": 0.04044395685195923,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.43286563835718267,
      "grad_norm": 0.5964503884315491,
      "learning_rate": 1.2074320832556558e-06,
      "loss": 0.0946,
      "mae_dtheta": 0.029792048037052155,
      "mae_dx": 0.008931294083595276,
      "mae_dy": 0.004721938632428646,
      "pose_mae_dtheta": 0.2181243598461151,
      "pose_mae_dx": 0.0728723406791687,
      "pose_mae_dy": 0.054355960339307785,
      "pose_rmse_dtheta": 0.3946145176887512,
      "pose_rmse_dx": 0.18498757481575012,
      "pose_rmse_dy": 0.11674413830041885,
      "pose_rmse_mean": 0.23211543262004852,
      "rmse_dtheta": 0.048565059900283813,
      "rmse_dx": 0.02137785777449608,
      "rmse_dy": 0.009788952767848969,
      "rmse_mean": 0.026577292010188103,
      "rotation_flip": 0.012239902280271053,
      "sparse_tokens": 17549.0,
      "step": 9317,
      "turn_loss": 0.1823536604642868,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.43291209812302545,
      "grad_norm": 0.8253902196884155,
      "learning_rate": 1.2065705822195084e-06,
      "loss": 0.1152,
      "mae_dtheta": 0.009632986970245838,
      "mae_dx": 0.0010587020078673959,
      "mae_dy": 0.001821296289563179,
      "pose_mae_dtheta": 0.05801884084939957,
      "pose_mae_dx": 0.012338593602180481,
      "pose_mae_dy": 0.020003216341137886,
      "pose_rmse_dtheta": 0.1786668598651886,
      "pose_rmse_dx": 0.030990278348326683,
      "pose_rmse_dy": 0.04280979186296463,
      "pose_rmse_mean": 0.08415564149618149,
      "rmse_dtheta": 0.023112162947654724,
      "rmse_dx": 0.0029098589438945055,
      "rmse_dy": 0.00398499658331275,
      "rmse_mean": 0.01000234019011259,
      "rotation_flip": 0.00544323492795229,
      "sparse_tokens": 32105.0,
      "step": 9318,
      "turn_loss": 0.07664518803358078,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22974.0,
      "epoch": 0.4329585578888682,
      "grad_norm": 0.44191035628318787,
      "learning_rate": 1.2057093464599156e-06,
      "loss": 0.1099,
      "mae_dtheta": 0.047922417521476746,
      "mae_dx": 0.010714995674788952,
      "mae_dy": 0.0038265720941126347,
      "pose_mae_dtheta": 0.4172550141811371,
      "pose_mae_dx": 0.08468411862850189,
      "pose_mae_dy": 0.04941598325967789,
      "pose_rmse_dtheta": 0.6752040386199951,
      "pose_rmse_dx": 0.18253697454929352,
      "pose_rmse_dy": 0.12156236916780472,
      "pose_rmse_mean": 0.326434463262558,
      "rmse_dtheta": 0.0677909180521965,
      "rmse_dx": 0.022729234769940376,
      "rmse_dy": 0.008585953153669834,
      "rmse_mean": 0.03303536772727966,
      "rotation_flip": 0.015780730172991753,
      "sparse_tokens": 18406.0,
      "step": 9319,
      "turn_loss": 0.27060461044311523,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.433005017654711,
      "grad_norm": 0.5571438670158386,
      "learning_rate": 1.2048483760371054e-06,
      "loss": 0.0863,
      "mae_dtheta": 0.03163401037454605,
      "mae_dx": 0.009760587476193905,
      "mae_dy": 0.005724315997213125,
      "pose_mae_dtheta": 0.2566099166870117,
      "pose_mae_dx": 0.07558664679527283,
      "pose_mae_dy": 0.10352110117673874,
      "pose_rmse_dtheta": 0.45123329758644104,
      "pose_rmse_dx": 0.17050281167030334,
      "pose_rmse_dy": 0.20634981989860535,
      "pose_rmse_mean": 0.2760286331176758,
      "rmse_dtheta": 0.049494992941617966,
      "rmse_dx": 0.020984036847949028,
      "rmse_dy": 0.010957828722894192,
      "rmse_mean": 0.027145620435476303,
      "rotation_flip": 0.010940918698906898,
      "sparse_tokens": 8701.0,
      "step": 9320,
      "turn_loss": 0.2131870985031128,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4330514774205538,
      "grad_norm": 0.5807614922523499,
      "learning_rate": 1.2039876710112847e-06,
      "loss": 0.1228,
      "mae_dtheta": 0.006867633201181889,
      "mae_dx": 0.0009278086945414543,
      "mae_dy": 0.0012269698781892657,
      "pose_mae_dtheta": 0.04471364989876747,
      "pose_mae_dx": 0.012213465757668018,
      "pose_mae_dy": 0.016018429771065712,
      "pose_rmse_dtheta": 0.1567944586277008,
      "pose_rmse_dx": 0.03482832759618759,
      "pose_rmse_dy": 0.04102646932005882,
      "pose_rmse_mean": 0.0775497555732727,
      "rmse_dtheta": 0.019998004660010338,
      "rmse_dx": 0.0031572619918733835,
      "rmse_dy": 0.003199421800673008,
      "rmse_mean": 0.008784896694123745,
      "rotation_flip": 0.0034381139557808638,
      "sparse_tokens": 32089.0,
      "step": 9321,
      "turn_loss": 0.053686805069446564,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.43309793718639655,
      "grad_norm": 0.4051695466041565,
      "learning_rate": 1.2031272314426446e-06,
      "loss": 0.0887,
      "mae_dtheta": 0.021746458485722542,
      "mae_dx": 0.007723916321992874,
      "mae_dy": 0.004273401107639074,
      "pose_mae_dtheta": 0.16452538967132568,
      "pose_mae_dx": 0.052902255207300186,
      "pose_mae_dy": 0.04448586329817772,
      "pose_rmse_dtheta": 0.27471601963043213,
      "pose_rmse_dx": 0.14574766159057617,
      "pose_rmse_dy": 0.12292611598968506,
      "pose_rmse_mean": 0.18112993240356445,
      "rmse_dtheta": 0.03609105944633484,
      "rmse_dx": 0.01873573288321495,
      "rmse_dy": 0.00914809387177229,
      "rmse_mean": 0.021324962377548218,
      "rotation_flip": 0.00978473573923111,
      "sparse_tokens": 8924.0,
      "step": 9322,
      "turn_loss": 0.17013205587863922,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4331443969522394,
      "grad_norm": 0.6677018404006958,
      "learning_rate": 1.2022670573913537e-06,
      "loss": 0.1161,
      "mae_dtheta": 0.008900663815438747,
      "mae_dx": 0.0016372615937143564,
      "mae_dy": 0.0025022579357028008,
      "pose_mae_dtheta": 0.061330460011959076,
      "pose_mae_dx": 0.024547401815652847,
      "pose_mae_dy": 0.02871863543987274,
      "pose_rmse_dtheta": 0.129985511302948,
      "pose_rmse_dx": 0.06539580971002579,
      "pose_rmse_dy": 0.06588900834321976,
      "pose_rmse_mean": 0.08709010481834412,
      "rmse_dtheta": 0.01831916533410549,
      "rmse_dx": 0.0043824780732393265,
      "rmse_dy": 0.005505283363163471,
      "rmse_mean": 0.009402308613061905,
      "rotation_flip": 0.00635424954816699,
      "sparse_tokens": 32089.0,
      "step": 9323,
      "turn_loss": 0.08748883008956909,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.43319085671808216,
      "grad_norm": 0.5038458108901978,
      "learning_rate": 1.2014071489175672e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.011521399952471256,
      "mae_dx": 0.002927327062934637,
      "mae_dy": 0.003765661967918277,
      "pose_mae_dtheta": 0.0839150995016098,
      "pose_mae_dx": 0.028222747147083282,
      "pose_mae_dy": 0.03154776245355606,
      "pose_rmse_dtheta": 0.1942288726568222,
      "pose_rmse_dx": 0.06603573262691498,
      "pose_rmse_dy": 0.07056708633899689,
      "pose_rmse_mean": 0.11027723550796509,
      "rmse_dtheta": 0.025567658245563507,
      "rmse_dx": 0.009119519963860512,
      "rmse_dy": 0.008714556694030762,
      "rmse_mean": 0.01446724496781826,
      "rotation_flip": 0.005374538246542215,
      "sparse_tokens": 32105.0,
      "step": 9324,
      "turn_loss": 0.10862550884485245,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.43323731648392494,
      "grad_norm": 0.4224143326282501,
      "learning_rate": 1.200547506081416e-06,
      "loss": 0.0616,
      "mae_dtheta": 0.007423756178468466,
      "mae_dx": 0.001149074058048427,
      "mae_dy": 0.0013149773003533483,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4224143326282501,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 168.26132202148438,
      "model/head/act_norm_mean": 122.01043639520202,
      "model/head/act_norm_min": 72.94746398925781,
      "model/head/act_over_embed": 83.84671417048527,
      "model/head/grad_frac": 0.06966060400009155,
      "model/head/grad_norm": 0.029425637796521187,
      "model/head/grad_zero_frac": 0.00021352390467654914,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7044073547979798,
      "model/head/update_ratio": 0.0005010305903851986,
      "model/head/weight_delta": 9.897439002990723,
      "model/head/weight_delta_rel": 0.17363040149211884,
      "model/head/weight_norm": 58.730220794677734,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42276206612586975,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42267803654007846,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226008951663971,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904683038844663,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10959938913583755,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04629635438323021,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5314251681614349,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014949246542528272,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1390433311462402,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1025623306632042,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96902084350586,
      "model/modality_embedder/grad_frac": 0.10959938913583755,
      "model/modality_embedder/grad_norm": 0.04629635438323021,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5314251681614349,
      "model/modality_embedder/update_ratio": 0.0014949246542528272,
      "model/modality_embedder/weight_delta": 3.1390433311462402,
      "model/modality_embedder/weight_delta_rel": 0.1025623306632042,
      "model/modality_embedder/weight_norm": 30.96902084350586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 94.3919677734375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.732092752926086,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.982621192932129,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.996125685311217,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05546372011303902,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.023428671061992645,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008382081869058311,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6956121921539307,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09822973608970642,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.950897216796875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 95.5632553100586,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.717374639249638,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.338711738586426,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.673220621947113,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05559806153178215,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.023485418409109116,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007893092115409672,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4177134037017822,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11839226633310318,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.754396438598633,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 97.377197265625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.512085137085137,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 11.937970161437988,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.906562478404076,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05083392560482025,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.021472979336977005,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0006988876848481596,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.69974684715271,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12423057109117508,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.724506378173828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 97.90963745117188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.177213604296938,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.8756685256958,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.050854350250347,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.04836773872375488,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02043122611939907,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006823732401244342,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1767637729644775,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10856670886278152,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.941423416137695,
      "model/normalizer/grad_frac": 0.2054658979177475,
      "model/normalizer/grad_norm": 0.0867917388677597,
      "model/normalizer/grad_zero_frac": 0.00022689378238283098,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001103669055737555,
      "model/normalizer/weight_delta": 6.688671112060547,
      "model/normalizer/weight_delta_rel": 0.08614621311426163,
      "model/normalizer/weight_norm": 78.6392822265625,
      "pose_mae_dtheta": 0.050811685621738434,
      "pose_mae_dx": 0.013034958392381668,
      "pose_mae_dy": 0.0187603160738945,
      "pose_rmse_dtheta": 0.15476533770561218,
      "pose_rmse_dx": 0.03300480917096138,
      "pose_rmse_dy": 0.048847854137420654,
      "pose_rmse_mean": 0.0788726657629013,
      "rmse_dtheta": 0.020909523591399193,
      "rmse_dx": 0.0035466516856104136,
      "rmse_dy": 0.003283747239038348,
      "rmse_mean": 0.009246640838682652,
      "rotation_flip": 0.002624671906232834,
      "sparse_tokens": 32105.0,
      "step": 9325,
      "turn_loss": 0.05706116557121277,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4332837762497677,
      "grad_norm": 0.327250599861145,
      "learning_rate": 1.1996881289430173e-06,
      "loss": 0.075,
      "mae_dtheta": 0.00865568034350872,
      "mae_dx": 0.0010374302510172129,
      "mae_dy": 0.0020339232869446278,
      "pose_mae_dtheta": 0.05704609304666519,
      "pose_mae_dx": 0.018576806411147118,
      "pose_mae_dy": 0.02722112461924553,
      "pose_rmse_dtheta": 0.1262904852628708,
      "pose_rmse_dx": 0.053501732647418976,
      "pose_rmse_dy": 0.07181119918823242,
      "pose_rmse_mean": 0.08386781066656113,
      "rmse_dtheta": 0.01907065138220787,
      "rmse_dx": 0.003448900068178773,
      "rmse_dy": 0.004772459622472525,
      "rmse_mean": 0.00909733772277832,
      "rotation_flip": 0.0071599045768380165,
      "sparse_tokens": 32073.0,
      "step": 9326,
      "turn_loss": 0.06552419066429138,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4333302360156105,
      "grad_norm": 0.4503330886363983,
      "learning_rate": 1.1988290175624684e-06,
      "loss": 0.1002,
      "mae_dtheta": 0.010216774418950081,
      "mae_dx": 0.0026428159326314926,
      "mae_dy": 0.003115147352218628,
      "pose_mae_dtheta": 0.0733223557472229,
      "pose_mae_dx": 0.035013627260923386,
      "pose_mae_dy": 0.031680554151535034,
      "pose_rmse_dtheta": 0.15578605234622955,
      "pose_rmse_dx": 0.09539444744586945,
      "pose_rmse_dy": 0.06920710951089859,
      "pose_rmse_mean": 0.10679586976766586,
      "rmse_dtheta": 0.020784448832273483,
      "rmse_dx": 0.007388534490019083,
      "rmse_dy": 0.007116928230971098,
      "rmse_mean": 0.01176330354064703,
      "rotation_flip": 0.002969317138195038,
      "sparse_tokens": 32137.0,
      "step": 9327,
      "turn_loss": 0.09876549988985062,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.43337669578145327,
      "grad_norm": 0.5404050350189209,
      "learning_rate": 1.1979701719998454e-06,
      "loss": 0.108,
      "mae_dtheta": 0.011613545939326286,
      "mae_dx": 0.0022527596447616816,
      "mae_dy": 0.0037403637543320656,
      "pose_mae_dtheta": 0.08010702580213547,
      "pose_mae_dx": 0.029698144644498825,
      "pose_mae_dy": 0.036641091108322144,
      "pose_rmse_dtheta": 0.18438208103179932,
      "pose_rmse_dx": 0.07759048044681549,
      "pose_rmse_dy": 0.08633238077163696,
      "pose_rmse_mean": 0.11610164493322372,
      "rmse_dtheta": 0.022615067660808563,
      "rmse_dx": 0.007104048505425453,
      "rmse_dy": 0.00813955720514059,
      "rmse_mean": 0.012619557790458202,
      "rotation_flip": 0.005441741552203894,
      "sparse_tokens": 32041.0,
      "step": 9328,
      "turn_loss": 0.11553244292736053,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.43342315554729605,
      "grad_norm": 0.7387350797653198,
      "learning_rate": 1.197111592315211e-06,
      "loss": 0.2361,
      "mae_dtheta": 0.025082997977733612,
      "mae_dx": 0.007426945958286524,
      "mae_dy": 0.005569050088524818,
      "pose_mae_dtheta": 0.20897062122821808,
      "pose_mae_dx": 0.07194549590349197,
      "pose_mae_dy": 0.06788156181573868,
      "pose_rmse_dtheta": 0.3671095073223114,
      "pose_rmse_dx": 0.15832988917827606,
      "pose_rmse_dy": 0.13284938037395477,
      "pose_rmse_mean": 0.2194295972585678,
      "rmse_dtheta": 0.04025954008102417,
      "rmse_dx": 0.018161242827773094,
      "rmse_dy": 0.01043279841542244,
      "rmse_mean": 0.022951196879148483,
      "rotation_flip": 0.015341701917350292,
      "sparse_tokens": 13129.0,
      "step": 9329,
      "turn_loss": 0.27224215865135193,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.4334696153131388,
      "grad_norm": 0.6677486896514893,
      "learning_rate": 1.196253278568602e-06,
      "loss": 0.1183,
      "mae_dtheta": 0.052522044628858566,
      "mae_dx": 0.023149339482188225,
      "mae_dy": 0.012354490347206593,
      "pose_mae_dtheta": 0.3910383880138397,
      "pose_mae_dx": 0.13687105476856232,
      "pose_mae_dy": 0.15217797458171844,
      "pose_rmse_dtheta": 0.6153338551521301,
      "pose_rmse_dx": 0.24241404235363007,
      "pose_rmse_dy": 0.29045912623405457,
      "pose_rmse_mean": 0.3827356994152069,
      "rmse_dtheta": 0.06961658596992493,
      "rmse_dx": 0.03477029502391815,
      "rmse_dy": 0.0207425057888031,
      "rmse_mean": 0.04170979559421539,
      "rotation_flip": 0.01744186133146286,
      "sparse_tokens": 2822.0,
      "step": 9330,
      "turn_loss": 0.6714217662811279,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.4335160750789816,
      "grad_norm": 0.741226851940155,
      "learning_rate": 1.1953952308200428e-06,
      "loss": 0.1089,
      "mae_dtheta": 0.028556346893310547,
      "mae_dx": 0.006526674143970013,
      "mae_dy": 0.0035335025750100613,
      "pose_mae_dtheta": 0.20666946470737457,
      "pose_mae_dx": 0.060005418956279755,
      "pose_mae_dy": 0.05113767832517624,
      "pose_rmse_dtheta": 0.413645476102829,
      "pose_rmse_dx": 0.11103476583957672,
      "pose_rmse_dy": 0.12059800326824188,
      "pose_rmse_mean": 0.2150927633047104,
      "rmse_dtheta": 0.04968678206205368,
      "rmse_dx": 0.015108082443475723,
      "rmse_dy": 0.007360097486525774,
      "rmse_mean": 0.02405165694653988,
      "rotation_flip": 0.01923076994717121,
      "sparse_tokens": 5515.0,
      "step": 9331,
      "turn_loss": 0.20666328072547913,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 26931.0,
      "epoch": 0.4335625348448244,
      "grad_norm": 0.5926668047904968,
      "learning_rate": 1.1945374491295392e-06,
      "loss": 0.1318,
      "mae_dtheta": 0.023547612130641937,
      "mae_dx": 0.006991767790168524,
      "mae_dy": 0.004220079630613327,
      "pose_mae_dtheta": 0.1890491396188736,
      "pose_mae_dx": 0.05251793563365936,
      "pose_mae_dy": 0.05925389751791954,
      "pose_rmse_dtheta": 0.35643890500068665,
      "pose_rmse_dx": 0.13546909391880035,
      "pose_rmse_dy": 0.12802287936210632,
      "pose_rmse_mean": 0.20664362609386444,
      "rmse_dtheta": 0.03905479982495308,
      "rmse_dx": 0.017397738993167877,
      "rmse_dy": 0.008199804462492466,
      "rmse_mean": 0.021550782024860382,
      "rotation_flip": 0.009671179577708244,
      "sparse_tokens": 19952.0,
      "step": 9332,
      "turn_loss": 0.18375654518604279,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.43360899461066715,
      "grad_norm": 0.47434478998184204,
      "learning_rate": 1.193679933557072e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.004933050833642483,
      "mae_dx": 0.000918536214157939,
      "mae_dy": 0.0007451297715306282,
      "pose_mae_dtheta": 0.035603057593107224,
      "pose_mae_dx": 0.00982404313981533,
      "pose_mae_dy": 0.012277811765670776,
      "pose_rmse_dtheta": 0.13363255560398102,
      "pose_rmse_dx": 0.02691020630300045,
      "pose_rmse_dy": 0.037170134484767914,
      "pose_rmse_mean": 0.06590430438518524,
      "rmse_dtheta": 0.01641741953790188,
      "rmse_dx": 0.0033519938588142395,
      "rmse_dy": 0.0018944147741422057,
      "rmse_mean": 0.007221275940537453,
      "rotation_flip": 0.0017804154194891453,
      "sparse_tokens": 32073.0,
      "step": 9333,
      "turn_loss": 0.036669619381427765,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.43365545437650993,
      "grad_norm": 0.5190298557281494,
      "learning_rate": 1.1928226841626123e-06,
      "loss": 0.14,
      "mae_dtheta": 0.03593411669135094,
      "mae_dx": 0.011153222061693668,
      "mae_dy": 0.004811798222362995,
      "pose_mae_dtheta": 0.25547322630882263,
      "pose_mae_dx": 0.08954457938671112,
      "pose_mae_dy": 0.04655289649963379,
      "pose_rmse_dtheta": 0.461129367351532,
      "pose_rmse_dx": 0.20272837579250336,
      "pose_rmse_dy": 0.16453997790813446,
      "pose_rmse_mean": 0.27613258361816406,
      "rmse_dtheta": 0.05498180910944939,
      "rmse_dx": 0.02282746694982052,
      "rmse_dy": 0.012516220100224018,
      "rmse_mean": 0.0301085002720356,
      "rotation_flip": 0.011520737782120705,
      "sparse_tokens": 20324.0,
      "step": 9334,
      "turn_loss": 0.23476676642894745,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.4337019141423527,
      "grad_norm": 0.8993666172027588,
      "learning_rate": 1.1919657010061037e-06,
      "loss": 0.2391,
      "mae_dtheta": 0.035418517887592316,
      "mae_dx": 0.010791485197842121,
      "mae_dy": 0.004645660985261202,
      "pose_mae_dtheta": 0.259408563375473,
      "pose_mae_dx": 0.09037814289331436,
      "pose_mae_dy": 0.07524599134922028,
      "pose_rmse_dtheta": 0.49111443758010864,
      "pose_rmse_dx": 0.22739548981189728,
      "pose_rmse_dy": 0.16407686471939087,
      "pose_rmse_mean": 0.29419559240341187,
      "rmse_dtheta": 0.054533131420612335,
      "rmse_dx": 0.024272095412015915,
      "rmse_dy": 0.007913789711892605,
      "rmse_mean": 0.028906337916851044,
      "rotation_flip": 0.013432836160063744,
      "sparse_tokens": 12270.0,
      "step": 9335,
      "turn_loss": 0.2595865726470947,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4337483739081955,
      "grad_norm": 0.5563499331474304,
      "learning_rate": 1.1911089841474793e-06,
      "loss": 0.0756,
      "mae_dtheta": 0.01069207675755024,
      "mae_dx": 0.0016833917470648885,
      "mae_dy": 0.0026069090235978365,
      "pose_mae_dtheta": 0.06773876398801804,
      "pose_mae_dx": 0.022276923060417175,
      "pose_mae_dy": 0.02830125391483307,
      "pose_rmse_dtheta": 0.1456373929977417,
      "pose_rmse_dx": 0.055364709347486496,
      "pose_rmse_dy": 0.06548011302947998,
      "pose_rmse_mean": 0.08882741630077362,
      "rmse_dtheta": 0.02048172987997532,
      "rmse_dx": 0.005036174785345793,
      "rmse_dy": 0.005158042535185814,
      "rmse_mean": 0.010225316509604454,
      "rotation_flip": 0.0057824356481432915,
      "sparse_tokens": 32057.0,
      "step": 9336,
      "turn_loss": 0.09601618349552155,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.43379483367403826,
      "grad_norm": 0.5099685788154602,
      "learning_rate": 1.1902525336466465e-06,
      "loss": 0.1203,
      "mae_dtheta": 0.009712094441056252,
      "mae_dx": 0.0016167861176654696,
      "mae_dy": 0.0015542011242359877,
      "pose_mae_dtheta": 0.06995796412229538,
      "pose_mae_dx": 0.01671547256410122,
      "pose_mae_dy": 0.020877737551927567,
      "pose_rmse_dtheta": 0.19145289063453674,
      "pose_rmse_dx": 0.04177531972527504,
      "pose_rmse_dy": 0.05532839894294739,
      "pose_rmse_mean": 0.09618553519248962,
      "rmse_dtheta": 0.023083044216036797,
      "rmse_dx": 0.004656268749386072,
      "rmse_dy": 0.003403180278837681,
      "rmse_mean": 0.010380830615758896,
      "rotation_flip": 0.0003741114924196154,
      "sparse_tokens": 32201.0,
      "step": 9337,
      "turn_loss": 0.07407789677381516,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31370.0,
      "epoch": 0.43384129343988104,
      "grad_norm": 0.9874109625816345,
      "learning_rate": 1.1893963495634986e-06,
      "loss": 0.2846,
      "mae_dtheta": 0.03621334210038185,
      "mae_dx": 0.015830421820282936,
      "mae_dy": 0.005565043073147535,
      "pose_mae_dtheta": 0.28687238693237305,
      "pose_mae_dx": 0.11850863695144653,
      "pose_mae_dy": 0.07257430255413055,
      "pose_rmse_dtheta": 0.4714714586734772,
      "pose_rmse_dx": 0.24754168093204498,
      "pose_rmse_dy": 0.1617179811000824,
      "pose_rmse_mean": 0.29357704520225525,
      "rmse_dtheta": 0.05081319063901901,
      "rmse_dx": 0.029366793110966682,
      "rmse_dy": 0.010604079812765121,
      "rmse_mean": 0.03026135265827179,
      "rotation_flip": 0.014354066923260689,
      "sparse_tokens": 23353.0,
      "step": 9338,
      "turn_loss": 0.29605406522750854,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 6178.0,
      "epoch": 0.43388775320572387,
      "grad_norm": 0.41917064785957336,
      "learning_rate": 1.1885404319579108e-06,
      "loss": 0.079,
      "mae_dtheta": 0.033586081117391586,
      "mae_dx": 0.00859855581074953,
      "mae_dy": 0.004264793358743191,
      "pose_mae_dtheta": 0.28768622875213623,
      "pose_mae_dx": 0.05482550337910652,
      "pose_mae_dy": 0.035689577460289,
      "pose_rmse_dtheta": 0.501889705657959,
      "pose_rmse_dx": 0.14549776911735535,
      "pose_rmse_dy": 0.08076135069131851,
      "pose_rmse_mean": 0.24271629750728607,
      "rmse_dtheta": 0.051536086946725845,
      "rmse_dx": 0.018496179953217506,
      "rmse_dy": 0.008986198343336582,
      "rmse_mean": 0.026339489966630936,
      "rotation_flip": 0.021739130839705467,
      "sparse_tokens": 4936.0,
      "step": 9339,
      "turn_loss": 0.2411569356918335,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 41213.0,
      "epoch": 0.43393421297156665,
      "grad_norm": 0.8868476748466492,
      "learning_rate": 1.1876847808897352e-06,
      "loss": 0.1481,
      "mae_dtheta": 0.03549416735768318,
      "mae_dx": 0.010224152356386185,
      "mae_dy": 0.00458153709769249,
      "pose_mae_dtheta": 0.27266427874565125,
      "pose_mae_dx": 0.08062383532524109,
      "pose_mae_dy": 0.049448832869529724,
      "pose_rmse_dtheta": 0.4898582398891449,
      "pose_rmse_dx": 0.20185954868793488,
      "pose_rmse_dy": 0.1361650973558426,
      "pose_rmse_mean": 0.2759609818458557,
      "rmse_dtheta": 0.054172057658433914,
      "rmse_dx": 0.022759510204195976,
      "rmse_dy": 0.01021148357540369,
      "rmse_mean": 0.029047682881355286,
      "rotation_flip": 0.01706484705209732,
      "sparse_tokens": 30113.0,
      "step": 9340,
      "turn_loss": 0.27573275566101074,
      "turns": 127.0,
      "turns_per_sample": 127.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4339806727374094,
      "grad_norm": 0.6605422496795654,
      "learning_rate": 1.1868293964188099e-06,
      "loss": 0.1372,
      "mae_dtheta": 0.01505650021135807,
      "mae_dx": 0.003766945330426097,
      "mae_dy": 0.0033870518673211336,
      "pose_mae_dtheta": 0.11603843420743942,
      "pose_mae_dx": 0.031115572899580002,
      "pose_mae_dy": 0.03987925499677658,
      "pose_rmse_dtheta": 0.28372374176979065,
      "pose_rmse_dx": 0.08809930086135864,
      "pose_rmse_dy": 0.11435268074274063,
      "pose_rmse_mean": 0.16205857694149017,
      "rmse_dtheta": 0.033839426934719086,
      "rmse_dx": 0.011591995134949684,
      "rmse_dy": 0.009206284768879414,
      "rmse_mean": 0.018212568014860153,
      "rotation_flip": 0.00435203080996871,
      "sparse_tokens": 32105.0,
      "step": 9341,
      "turn_loss": 0.14765547215938568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.4340271325032522,
      "grad_norm": 0.5497485399246216,
      "learning_rate": 1.1859742786049505e-06,
      "loss": 0.1189,
      "mae_dtheta": 0.031336624175310135,
      "mae_dx": 0.008283096365630627,
      "mae_dy": 0.005444614216685295,
      "pose_mae_dtheta": 0.24111174046993256,
      "pose_mae_dx": 0.060932207852602005,
      "pose_mae_dy": 0.07771069556474686,
      "pose_rmse_dtheta": 0.4513673186302185,
      "pose_rmse_dx": 0.14514796435832977,
      "pose_rmse_dy": 0.19098295271396637,
      "pose_rmse_mean": 0.2624994218349457,
      "rmse_dtheta": 0.049262624233961105,
      "rmse_dx": 0.018827306106686592,
      "rmse_dy": 0.011873697862029076,
      "rmse_mean": 0.026654545217752457,
      "rotation_flip": 0.005361930467188358,
      "sparse_tokens": 14468.0,
      "step": 9342,
      "turn_loss": 0.2703285217285156,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.434073592269095,
      "grad_norm": 0.665485680103302,
      "learning_rate": 1.1851194275079586e-06,
      "loss": 0.1648,
      "mae_dtheta": 0.046267684549093246,
      "mae_dx": 0.01774807646870613,
      "mae_dy": 0.004572112113237381,
      "pose_mae_dtheta": 0.41704100370407104,
      "pose_mae_dx": 0.14405497908592224,
      "pose_mae_dy": 0.06088918820023537,
      "pose_rmse_dtheta": 0.6638278365135193,
      "pose_rmse_dx": 0.30622977018356323,
      "pose_rmse_dy": 0.14419275522232056,
      "pose_rmse_mean": 0.3714168071746826,
      "rmse_dtheta": 0.06501343101263046,
      "rmse_dx": 0.032067447900772095,
      "rmse_dy": 0.008768964558839798,
      "rmse_mean": 0.03528328239917755,
      "rotation_flip": 0.014893617480993271,
      "sparse_tokens": 8353.0,
      "step": 9343,
      "turn_loss": 0.31932443380355835,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.43412005203493775,
      "grad_norm": 0.3994434177875519,
      "learning_rate": 1.184264843187611e-06,
      "loss": 0.0704,
      "mae_dtheta": 0.03636247292160988,
      "mae_dx": 0.012284422293305397,
      "mae_dy": 0.006040108855813742,
      "pose_mae_dtheta": 0.23868010938167572,
      "pose_mae_dx": 0.08732742816209793,
      "pose_mae_dy": 0.0917825773358345,
      "pose_rmse_dtheta": 0.38323158025741577,
      "pose_rmse_dx": 0.16280801594257355,
      "pose_rmse_dy": 0.18026158213615417,
      "pose_rmse_mean": 0.24210040271282196,
      "rmse_dtheta": 0.05416387692093849,
      "rmse_dx": 0.022336086258292198,
      "rmse_dy": 0.009938041679561138,
      "rmse_mean": 0.028812667354941368,
      "rotation_flip": 0.0,
      "sparse_tokens": 4319.0,
      "step": 9344,
      "turn_loss": 0.3653073012828827,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.43416651180078053,
      "grad_norm": 0.7146686315536499,
      "learning_rate": 1.183410525703671e-06,
      "loss": 0.1619,
      "mae_dtheta": 0.026479769498109818,
      "mae_dx": 0.012816897593438625,
      "mae_dy": 0.005825767759233713,
      "pose_mae_dtheta": 0.22779569029808044,
      "pose_mae_dx": 0.09049873054027557,
      "pose_mae_dy": 0.04362840950489044,
      "pose_rmse_dtheta": 0.39094623923301697,
      "pose_rmse_dx": 0.19227372109889984,
      "pose_rmse_dy": 0.10220709443092346,
      "pose_rmse_mean": 0.2284756898880005,
      "rmse_dtheta": 0.041922129690647125,
      "rmse_dx": 0.025323638692498207,
      "rmse_dy": 0.013766943477094173,
      "rmse_mean": 0.027004238218069077,
      "rotation_flip": 0.007407407276332378,
      "sparse_tokens": 6854.0,
      "step": 9345,
      "turn_loss": 0.2596350908279419,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.4342129715666233,
      "grad_norm": 1.1649584770202637,
      "learning_rate": 1.1825564751158825e-06,
      "loss": 0.3219,
      "mae_dtheta": 0.028712483122944832,
      "mae_dx": 0.009314678609371185,
      "mae_dy": 0.004491628147661686,
      "pose_mae_dtheta": 0.21058867871761322,
      "pose_mae_dx": 0.064498670399189,
      "pose_mae_dy": 0.05077536776661873,
      "pose_rmse_dtheta": 0.40398266911506653,
      "pose_rmse_dx": 0.1515016108751297,
      "pose_rmse_dy": 0.1177951842546463,
      "pose_rmse_mean": 0.2244264930486679,
      "rmse_dtheta": 0.048742033541202545,
      "rmse_dx": 0.02158544957637787,
      "rmse_dy": 0.009257646277546883,
      "rmse_mean": 0.02652837708592415,
      "rotation_flip": 0.011345218867063522,
      "sparse_tokens": 9148.0,
      "step": 9346,
      "turn_loss": 0.18154798448085785,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4342594313324661,
      "grad_norm": 0.4806339144706726,
      "learning_rate": 1.181702691483968e-06,
      "loss": 0.1044,
      "mae_dtheta": 0.006065544672310352,
      "mae_dx": 0.0012433038791641593,
      "mae_dy": 0.0011760860215872526,
      "pose_mae_dtheta": 0.03946222364902496,
      "pose_mae_dx": 0.012058079242706299,
      "pose_mae_dy": 0.012628179043531418,
      "pose_rmse_dtheta": 0.13304287195205688,
      "pose_rmse_dx": 0.03392908349633217,
      "pose_rmse_dy": 0.03418280929327011,
      "pose_rmse_mean": 0.06705158948898315,
      "rmse_dtheta": 0.01821800507605076,
      "rmse_dx": 0.0035562096163630486,
      "rmse_dy": 0.0031811543740332127,
      "rmse_mean": 0.008318455889821053,
      "rotation_flip": 0.000936329597607255,
      "sparse_tokens": 32185.0,
      "step": 9347,
      "turn_loss": 0.04645725339651108,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.43430589109830886,
      "grad_norm": 0.46815025806427,
      "learning_rate": 1.1808491748676343e-06,
      "loss": 0.0989,
      "mae_dtheta": 0.009195138700306416,
      "mae_dx": 0.001454074401408434,
      "mae_dy": 0.0014256188878789544,
      "pose_mae_dtheta": 0.06205672398209572,
      "pose_mae_dx": 0.016643017530441284,
      "pose_mae_dy": 0.01792171224951744,
      "pose_rmse_dtheta": 0.18759891390800476,
      "pose_rmse_dx": 0.040366608649492264,
      "pose_rmse_dy": 0.043544668704271317,
      "pose_rmse_mean": 0.09050339460372925,
      "rmse_dtheta": 0.023713821545243263,
      "rmse_dx": 0.0043741497211158276,
      "rmse_dy": 0.003126602852717042,
      "rmse_mean": 0.010404858738183975,
      "rotation_flip": 0.0013764625182375312,
      "sparse_tokens": 32217.0,
      "step": 9348,
      "turn_loss": 0.05358488857746124,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.43435235086415164,
      "grad_norm": 0.5347054600715637,
      "learning_rate": 1.1799959253265668e-06,
      "loss": 0.1177,
      "mae_dtheta": 0.042535312473773956,
      "mae_dx": 0.005662940442562103,
      "mae_dy": 0.004356749821454287,
      "pose_mae_dtheta": 0.32512354850769043,
      "pose_mae_dx": 0.05813051387667656,
      "pose_mae_dy": 0.0531650073826313,
      "pose_rmse_dtheta": 0.5847760438919067,
      "pose_rmse_dx": 0.1159730926156044,
      "pose_rmse_dy": 0.11324971169233322,
      "pose_rmse_mean": 0.2713329792022705,
      "rmse_dtheta": 0.06190035864710808,
      "rmse_dx": 0.013499324209988117,
      "rmse_dy": 0.008456146344542503,
      "rmse_mean": 0.02795194461941719,
      "rotation_flip": 0.01886792480945587,
      "sparse_tokens": 5134.0,
      "step": 9349,
      "turn_loss": 0.28686198592185974,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 16837.0,
      "epoch": 0.4343988106299944,
      "grad_norm": 0.35703691840171814,
      "learning_rate": 1.1791429429204343e-06,
      "loss": 0.0993,
      "mae_dtheta": 0.029411908239126205,
      "mae_dx": 0.008114231750369072,
      "mae_dy": 0.0027875814121216536,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.35703691840171814,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.44033813476562,
      "model/head/act_norm_mean": 105.35845477764423,
      "model/head/act_norm_min": 72.50835418701172,
      "model/head/act_over_embed": 72.40331650459143,
      "model/head/grad_frac": 0.11360777914524078,
      "model/head/grad_norm": 0.04056217148900032,
      "model/head/grad_zero_frac": 0.00021479299175553024,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6921950120192307,
      "model/head/update_ratio": 0.0006906464695930481,
      "model/head/weight_delta": 9.899447441101074,
      "model/head/weight_delta_rel": 0.1736656278371811,
      "model/head/weight_norm": 58.73072814941406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42267942428588867,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42267942428588867,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42267942428588867,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29046925755637937,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10181748121976852,
      "model/modality_embedder.encoders.pose/grad_norm": 0.036352600902318954,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011738322209566832,
      "model/modality_embedder.encoders.pose/weight_delta": 3.139539957046509,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1025785580277443,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969161987304688,
      "model/modality_embedder/grad_frac": 0.10181748121976852,
      "model/modality_embedder/grad_norm": 0.036352600902318954,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0011738322209566832,
      "model/modality_embedder/weight_delta": 3.139539957046509,
      "model/modality_embedder/weight_delta_rel": 0.1025785580277443,
      "model/modality_embedder/weight_norm": 30.969161987304688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.59732818603516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.182720924908423,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.203347206115723,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.93138285964989,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0760030597448349,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.027135897427797318,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.000970827357377857,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6968514919281006,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09827489405870438,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.951311111450195,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 75.89018249511719,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.007142380189254,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.752880096435547,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.497933002074145,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0695762038230896,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.024841273203492165,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008348635747097433,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.419311046600342,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11844760924577713,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.7548885345459,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 77.4310073852539,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.646019345238095,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.983685493469238,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.624184595863596,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06791560351848602,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.024248376488685608,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000789206416811794,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.701521158218384,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12429015338420868,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.725011825561523,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 77.8903579711914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.454181452228326,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.745607376098633,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.866770524067636,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06738965958356857,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.024060597643256187,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.000803579983767122,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.178365468978882,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10862144827842712,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.94175910949707,
      "model/normalizer/grad_frac": 0.2587530016899109,
      "model/normalizer/grad_norm": 0.09238437563180923,
      "model/normalizer/grad_zero_frac": 0.00021389465837273747,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0011747784446924925,
      "model/normalizer/weight_delta": 6.691859245300293,
      "model/normalizer/weight_delta_rel": 0.08618727326393127,
      "model/normalizer/weight_norm": 78.63983154296875,
      "pose_mae_dtheta": 0.23682790994644165,
      "pose_mae_dx": 0.06811390072107315,
      "pose_mae_dy": 0.028009044006466866,
      "pose_rmse_dtheta": 0.4550830125808716,
      "pose_rmse_dx": 0.1617763489484787,
      "pose_rmse_dy": 0.062461357563734055,
      "pose_rmse_mean": 0.22644025087356567,
      "rmse_dtheta": 0.04946146905422211,
      "rmse_dx": 0.018326204270124435,
      "rmse_dy": 0.005786163732409477,
      "rmse_mean": 0.024524614214897156,
      "rotation_flip": 0.014945652335882187,
      "sparse_tokens": 13349.0,
      "step": 9350,
      "turn_loss": 0.188486248254776,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.4344452703958372,
      "grad_norm": 0.8155449032783508,
      "learning_rate": 1.178290227708888e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.030781755223870277,
      "mae_dx": 0.011352121829986572,
      "mae_dy": 0.003926829434931278,
      "pose_mae_dtheta": 0.23088949918746948,
      "pose_mae_dx": 0.0847574919462204,
      "pose_mae_dy": 0.04834005609154701,
      "pose_rmse_dtheta": 0.4250290095806122,
      "pose_rmse_dx": 0.18598012626171112,
      "pose_rmse_dy": 0.10069466382265091,
      "pose_rmse_mean": 0.23723459243774414,
      "rmse_dtheta": 0.04709834232926369,
      "rmse_dx": 0.023208150640130043,
      "rmse_dy": 0.00649247644469142,
      "rmse_mean": 0.025599656626582146,
      "rotation_flip": 0.01243339292705059,
      "sparse_tokens": 10538.0,
      "step": 9351,
      "turn_loss": 0.22593387961387634,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.43449173016167997,
      "grad_norm": 0.322468638420105,
      "learning_rate": 1.1774377797515563e-06,
      "loss": 0.0605,
      "mae_dtheta": 0.021478092297911644,
      "mae_dx": 0.012928448617458344,
      "mae_dy": 0.005458055529743433,
      "pose_mae_dtheta": 0.18574978411197662,
      "pose_mae_dx": 0.09776507318019867,
      "pose_mae_dy": 0.07725320011377335,
      "pose_rmse_dtheta": 0.33966168761253357,
      "pose_rmse_dx": 0.2239183932542801,
      "pose_rmse_dy": 0.1856149286031723,
      "pose_rmse_mean": 0.24973168969154358,
      "rmse_dtheta": 0.03525262698531151,
      "rmse_dx": 0.0262195635586977,
      "rmse_dy": 0.0110164238139987,
      "rmse_mean": 0.02416287176311016,
      "rotation_flip": 0.015968063846230507,
      "sparse_tokens": 10608.0,
      "step": 9352,
      "turn_loss": 0.19954590499401093,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.43453818992752274,
      "grad_norm": 0.3735039532184601,
      "learning_rate": 1.1765855991080533e-06,
      "loss": 0.1058,
      "mae_dtheta": 0.007043884135782719,
      "mae_dx": 0.0008391696610487998,
      "mae_dy": 0.0015528033254668117,
      "pose_mae_dtheta": 0.045216236263513565,
      "pose_mae_dx": 0.008295268751680851,
      "pose_mae_dy": 0.017037350684404373,
      "pose_rmse_dtheta": 0.14720995724201202,
      "pose_rmse_dx": 0.025031691417098045,
      "pose_rmse_dy": 0.037591490894556046,
      "pose_rmse_mean": 0.06994438171386719,
      "rmse_dtheta": 0.01775534823536873,
      "rmse_dx": 0.0024203206412494183,
      "rmse_dy": 0.004230554215610027,
      "rmse_mean": 0.008135408163070679,
      "rotation_flip": 0.005610098131000996,
      "sparse_tokens": 32089.0,
      "step": 9353,
      "turn_loss": 0.055025890469551086,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.4345846496933655,
      "grad_norm": 0.9063495993614197,
      "learning_rate": 1.1757336858379715e-06,
      "loss": 0.2232,
      "mae_dtheta": 0.024795997887849808,
      "mae_dx": 0.013153208419680595,
      "mae_dy": 0.0025395038537681103,
      "pose_mae_dtheta": 0.15930145978927612,
      "pose_mae_dx": 0.09863908588886261,
      "pose_mae_dy": 0.027675310149788857,
      "pose_rmse_dtheta": 0.2594112753868103,
      "pose_rmse_dx": 0.20531485974788666,
      "pose_rmse_dy": 0.061330392956733704,
      "pose_rmse_mean": 0.17535218596458435,
      "rmse_dtheta": 0.04058340936899185,
      "rmse_dx": 0.024288861081004143,
      "rmse_dy": 0.005092469975352287,
      "rmse_mean": 0.02332158200442791,
      "rotation_flip": 0.019083969295024872,
      "sparse_tokens": 4237.0,
      "step": 9354,
      "turn_loss": 0.1995716094970703,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.4346311094592083,
      "grad_norm": 0.5712631940841675,
      "learning_rate": 1.1748820400008843e-06,
      "loss": 0.14,
      "mae_dtheta": 0.04033225402235985,
      "mae_dx": 0.0073415664955973625,
      "mae_dy": 0.010290075093507767,
      "pose_mae_dtheta": 0.3323740065097809,
      "pose_mae_dx": 0.0690566822886467,
      "pose_mae_dy": 0.08838508278131485,
      "pose_rmse_dtheta": 0.5393157601356506,
      "pose_rmse_dx": 0.2042030245065689,
      "pose_rmse_dy": 0.1999397575855255,
      "pose_rmse_mean": 0.31448620557785034,
      "rmse_dtheta": 0.06145801022648811,
      "rmse_dx": 0.016849782317876816,
      "rmse_dy": 0.022428885102272034,
      "rmse_mean": 0.03357889503240585,
      "rotation_flip": 0.019498607143759727,
      "sparse_tokens": 5632.0,
      "step": 9355,
      "turn_loss": 0.2902691960334778,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.43467756922505113,
      "grad_norm": 0.6885020732879639,
      "learning_rate": 1.1740306616563506e-06,
      "loss": 0.1291,
      "mae_dtheta": 0.012803162448108196,
      "mae_dx": 0.0013020170154049993,
      "mae_dy": 0.0028667794540524483,
      "pose_mae_dtheta": 0.08119165152311325,
      "pose_mae_dx": 0.023443134501576424,
      "pose_mae_dy": 0.035267025232315063,
      "pose_rmse_dtheta": 0.19428732991218567,
      "pose_rmse_dx": 0.06310180574655533,
      "pose_rmse_dy": 0.08745887875556946,
      "pose_rmse_mean": 0.11494933813810349,
      "rmse_dtheta": 0.02619190886616707,
      "rmse_dx": 0.0032531963661313057,
      "rmse_dy": 0.005981558468192816,
      "rmse_mean": 0.011808887124061584,
      "rotation_flip": 0.00480384286493063,
      "sparse_tokens": 32057.0,
      "step": 9356,
      "turn_loss": 0.0988851860165596,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4347240289908939,
      "grad_norm": 0.4982571601867676,
      "learning_rate": 1.173179550863905e-06,
      "loss": 0.0903,
      "mae_dtheta": 0.011270503513514996,
      "mae_dx": 0.0016150485025718808,
      "mae_dy": 0.0030642568599432707,
      "pose_mae_dtheta": 0.07510986179113388,
      "pose_mae_dx": 0.029184771701693535,
      "pose_mae_dy": 0.034322064369916916,
      "pose_rmse_dtheta": 0.15945081412792206,
      "pose_rmse_dx": 0.08899299055337906,
      "pose_rmse_dy": 0.07818643003702164,
      "pose_rmse_mean": 0.10887674987316132,
      "rmse_dtheta": 0.021916957572102547,
      "rmse_dx": 0.005201238673180342,
      "rmse_dy": 0.006850117817521095,
      "rmse_mean": 0.01132277213037014,
      "rotation_flip": 0.003746721660718322,
      "sparse_tokens": 32057.0,
      "step": 9357,
      "turn_loss": 0.10279763489961624,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4347704887567367,
      "grad_norm": 0.5881218910217285,
      "learning_rate": 1.1723287076830686e-06,
      "loss": 0.1043,
      "mae_dtheta": 0.009470316581428051,
      "mae_dx": 0.001968932105228305,
      "mae_dy": 0.003026423277333379,
      "pose_mae_dtheta": 0.06224651262164116,
      "pose_mae_dx": 0.023106811568140984,
      "pose_mae_dy": 0.026671651750802994,
      "pose_rmse_dtheta": 0.13500410318374634,
      "pose_rmse_dx": 0.06161418929696083,
      "pose_rmse_dy": 0.06289342790842056,
      "pose_rmse_mean": 0.08650390803813934,
      "rmse_dtheta": 0.01914581097662449,
      "rmse_dx": 0.005334627348929644,
      "rmse_dy": 0.007351561915129423,
      "rmse_mean": 0.010610666126012802,
      "rotation_flip": 0.007130124606192112,
      "sparse_tokens": 32121.0,
      "step": 9358,
      "turn_loss": 0.09796321392059326,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.43481694852257946,
      "grad_norm": 0.34058940410614014,
      "learning_rate": 1.1714781321733387e-06,
      "loss": 0.0558,
      "mae_dtheta": 0.008479590527713299,
      "mae_dx": 0.0013700660783797503,
      "mae_dy": 0.0016172992764040828,
      "pose_mae_dtheta": 0.05721132457256317,
      "pose_mae_dx": 0.014240670949220657,
      "pose_mae_dy": 0.020186346024274826,
      "pose_rmse_dtheta": 0.1561260223388672,
      "pose_rmse_dx": 0.03886385262012482,
      "pose_rmse_dy": 0.051410384476184845,
      "pose_rmse_mean": 0.08213342726230621,
      "rmse_dtheta": 0.021313805133104324,
      "rmse_dx": 0.0042185103520751,
      "rmse_dy": 0.004016724415123463,
      "rmse_mean": 0.009849680587649345,
      "rotation_flip": 0.001985111739486456,
      "sparse_tokens": 32089.0,
      "step": 9359,
      "turn_loss": 0.06459833681583405,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.43486340828842224,
      "grad_norm": 0.44942939281463623,
      "learning_rate": 1.1706278243941998e-06,
      "loss": 0.0878,
      "mae_dtheta": 0.011310514062643051,
      "mae_dx": 0.0030684026423841715,
      "mae_dy": 0.003311984473839402,
      "pose_mae_dtheta": 0.08840446174144745,
      "pose_mae_dx": 0.032973743975162506,
      "pose_mae_dy": 0.026752904057502747,
      "pose_rmse_dtheta": 0.24378567934036255,
      "pose_rmse_dx": 0.11137476563453674,
      "pose_rmse_dy": 0.08194349706172943,
      "pose_rmse_mean": 0.1457013189792633,
      "rmse_dtheta": 0.027659524232149124,
      "rmse_dx": 0.009543211199343204,
      "rmse_dy": 0.011008089408278465,
      "rmse_mean": 0.016070274636149406,
      "rotation_flip": 0.005959475412964821,
      "sparse_tokens": 32057.0,
      "step": 9360,
      "turn_loss": 0.10522674024105072,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.434909868054265,
      "grad_norm": 0.4676210880279541,
      "learning_rate": 1.1697777844051105e-06,
      "loss": 0.0993,
      "mae_dtheta": 0.025853991508483887,
      "mae_dx": 0.008215012028813362,
      "mae_dy": 0.0035955533385276794,
      "pose_mae_dtheta": 0.17201180756092072,
      "pose_mae_dx": 0.06295017153024673,
      "pose_mae_dy": 0.03501559793949127,
      "pose_rmse_dtheta": 0.3396186828613281,
      "pose_rmse_dx": 0.1344149112701416,
      "pose_rmse_dy": 0.08684065192937851,
      "pose_rmse_mean": 0.18695807456970215,
      "rmse_dtheta": 0.042796362191438675,
      "rmse_dx": 0.018606331199407578,
      "rmse_dy": 0.0074150352738797665,
      "rmse_mean": 0.02293924242258072,
      "rotation_flip": 0.015584415756165981,
      "sparse_tokens": 14018.0,
      "step": 9361,
      "turn_loss": 0.21765507757663727,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4349563278201078,
      "grad_norm": 0.6207677125930786,
      "learning_rate": 1.1689280122655183e-06,
      "loss": 0.1576,
      "mae_dtheta": 0.010443593375384808,
      "mae_dx": 0.0012800164986401796,
      "mae_dy": 0.0020139487460255623,
      "pose_mae_dtheta": 0.06857918202877045,
      "pose_mae_dx": 0.02137485332787037,
      "pose_mae_dy": 0.029858455061912537,
      "pose_rmse_dtheta": 0.1644936203956604,
      "pose_rmse_dx": 0.057910267263650894,
      "pose_rmse_dy": 0.07245562970638275,
      "pose_rmse_mean": 0.09828650951385498,
      "rmse_dtheta": 0.022285450249910355,
      "rmse_dx": 0.004544458352029324,
      "rmse_dy": 0.004190331790596247,
      "rmse_mean": 0.010340080596506596,
      "rotation_flip": 0.002515723230317235,
      "sparse_tokens": 32041.0,
      "step": 9362,
      "turn_loss": 0.0684177502989769,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.43500278758595057,
      "grad_norm": 0.3189376890659332,
      "learning_rate": 1.168078508034845e-06,
      "loss": 0.0753,
      "mae_dtheta": 0.012244009412825108,
      "mae_dx": 0.0018024425953626633,
      "mae_dy": 0.0025952740106731653,
      "pose_mae_dtheta": 0.08318036794662476,
      "pose_mae_dx": 0.025613028556108475,
      "pose_mae_dy": 0.03499191999435425,
      "pose_rmse_dtheta": 0.1985006034374237,
      "pose_rmse_dx": 0.07338421046733856,
      "pose_rmse_dy": 0.0831809788942337,
      "pose_rmse_mean": 0.11835525929927826,
      "rmse_dtheta": 0.0261148139834404,
      "rmse_dx": 0.006296596489846706,
      "rmse_dy": 0.005804336164146662,
      "rmse_mean": 0.012738583609461784,
      "rotation_flip": 0.003091872902587056,
      "sparse_tokens": 32041.0,
      "step": 9363,
      "turn_loss": 0.10977932065725327,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12999.0,
      "epoch": 0.43504924735179334,
      "grad_norm": 0.9551615715026855,
      "learning_rate": 1.167229271772498e-06,
      "loss": 0.254,
      "mae_dtheta": 0.02999802865087986,
      "mae_dx": 0.007692999206483364,
      "mae_dy": 0.0038898310158401728,
      "pose_mae_dtheta": 0.2424139380455017,
      "pose_mae_dx": 0.05354063957929611,
      "pose_mae_dy": 0.03984379023313522,
      "pose_rmse_dtheta": 0.44746240973472595,
      "pose_rmse_dx": 0.1330689936876297,
      "pose_rmse_dy": 0.09885257482528687,
      "pose_rmse_mean": 0.22646133601665497,
      "rmse_dtheta": 0.05055202543735504,
      "rmse_dx": 0.017736535519361496,
      "rmse_dy": 0.01022215373814106,
      "rmse_mean": 0.026170238852500916,
      "rotation_flip": 0.013182674534618855,
      "sparse_tokens": 10383.0,
      "step": 9364,
      "turn_loss": 0.24556632339954376,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4350957071176361,
      "grad_norm": 0.4035632610321045,
      "learning_rate": 1.1663803035378667e-06,
      "loss": 0.0743,
      "mae_dtheta": 0.009077492170035839,
      "mae_dx": 0.001403327565640211,
      "mae_dy": 0.0015569932293146849,
      "pose_mae_dtheta": 0.06235380843281746,
      "pose_mae_dx": 0.015241929329931736,
      "pose_mae_dy": 0.017423460260033607,
      "pose_rmse_dtheta": 0.19888311624526978,
      "pose_rmse_dx": 0.04567268118262291,
      "pose_rmse_dy": 0.0393068790435791,
      "pose_rmse_mean": 0.09462089836597443,
      "rmse_dtheta": 0.024343492463231087,
      "rmse_dx": 0.004291047807782888,
      "rmse_dy": 0.004342957399785519,
      "rmse_mean": 0.010992499999701977,
      "rotation_flip": 0.0024764735717326403,
      "sparse_tokens": 32105.0,
      "step": 9365,
      "turn_loss": 0.07350525259971619,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.4351421668834789,
      "grad_norm": 1.0113526582717896,
      "learning_rate": 1.1655316033903175e-06,
      "loss": 0.282,
      "mae_dtheta": 0.036900606006383896,
      "mae_dx": 0.01323888823390007,
      "mae_dy": 0.007349033374339342,
      "pose_mae_dtheta": 0.2727062702178955,
      "pose_mae_dx": 0.0940432995557785,
      "pose_mae_dy": 0.07655943185091019,
      "pose_rmse_dtheta": 0.4356229603290558,
      "pose_rmse_dx": 0.21022716164588928,
      "pose_rmse_dy": 0.16231867671012878,
      "pose_rmse_mean": 0.2693895995616913,
      "rmse_dtheta": 0.05240488797426224,
      "rmse_dx": 0.02614612691104412,
      "rmse_dy": 0.014410916715860367,
      "rmse_mean": 0.030987313017249107,
      "rotation_flip": 0.015177065506577492,
      "sparse_tokens": 11489.0,
      "step": 9366,
      "turn_loss": 0.3147374093532562,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4351886266493217,
      "grad_norm": 0.435271292924881,
      "learning_rate": 1.164683171389202e-06,
      "loss": 0.0946,
      "mae_dtheta": 0.008961379528045654,
      "mae_dx": 0.0013311767252162099,
      "mae_dy": 0.0022446131333708763,
      "pose_mae_dtheta": 0.05890322104096413,
      "pose_mae_dx": 0.018679220229387283,
      "pose_mae_dy": 0.023268068209290504,
      "pose_rmse_dtheta": 0.13692066073417664,
      "pose_rmse_dx": 0.041171398013830185,
      "pose_rmse_dy": 0.048811156302690506,
      "pose_rmse_mean": 0.07563440501689911,
      "rmse_dtheta": 0.017796941101551056,
      "rmse_dx": 0.003719387808814645,
      "rmse_dy": 0.004567008465528488,
      "rmse_mean": 0.008694445714354515,
      "rotation_flip": 0.005998588632792234,
      "sparse_tokens": 32105.0,
      "step": 9367,
      "turn_loss": 0.07684276252985,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11344.0,
      "epoch": 0.43523508641516445,
      "grad_norm": 0.5390394926071167,
      "learning_rate": 1.1638350075938504e-06,
      "loss": 0.1184,
      "mae_dtheta": 0.03717067092657089,
      "mae_dx": 0.007164803799241781,
      "mae_dy": 0.005986351985484362,
      "pose_mae_dtheta": 0.30804353952407837,
      "pose_mae_dx": 0.06506707519292831,
      "pose_mae_dy": 0.08020831644535065,
      "pose_rmse_dtheta": 0.5168354511260986,
      "pose_rmse_dx": 0.14014379680156708,
      "pose_rmse_dy": 0.16644199192523956,
      "pose_rmse_mean": 0.27447375655174255,
      "rmse_dtheta": 0.05451540648937225,
      "rmse_dx": 0.01702042482793331,
      "rmse_dy": 0.01049389410763979,
      "rmse_mean": 0.02734324336051941,
      "rotation_flip": 0.01666666753590107,
      "sparse_tokens": 8638.0,
      "step": 9368,
      "turn_loss": 0.2395569384098053,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.43528154618100723,
      "grad_norm": 0.6051837205886841,
      "learning_rate": 1.1629871120635749e-06,
      "loss": 0.0877,
      "mae_dtheta": 0.004782152362167835,
      "mae_dx": 0.000886393419932574,
      "mae_dy": 0.0007955670007504523,
      "pose_mae_dtheta": 0.03235112130641937,
      "pose_mae_dx": 0.009067508392035961,
      "pose_mae_dy": 0.012081469409167767,
      "pose_rmse_dtheta": 0.10223022848367691,
      "pose_rmse_dx": 0.024449553340673447,
      "pose_rmse_dy": 0.031204761937260628,
      "pose_rmse_mean": 0.052628181874752045,
      "rmse_dtheta": 0.014775457791984081,
      "rmse_dx": 0.0029528748709708452,
      "rmse_dy": 0.0017478439258411527,
      "rmse_mean": 0.006492059212177992,
      "rotation_flip": 0.0022789426147937775,
      "sparse_tokens": 32137.0,
      "step": 9369,
      "turn_loss": 0.03828739747405052,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.43532800594685,
      "grad_norm": 0.6069927215576172,
      "learning_rate": 1.1621394848576716e-06,
      "loss": 0.1409,
      "mae_dtheta": 0.03983704745769501,
      "mae_dx": 0.022035297006368637,
      "mae_dy": 0.007582459598779678,
      "pose_mae_dtheta": 0.2602795362472534,
      "pose_mae_dx": 0.17626610398292542,
      "pose_mae_dy": 0.1390286684036255,
      "pose_rmse_dtheta": 0.406996488571167,
      "pose_rmse_dx": 0.35251307487487793,
      "pose_rmse_dy": 0.24206921458244324,
      "pose_rmse_mean": 0.3338596224784851,
      "rmse_dtheta": 0.056994929909706116,
      "rmse_dx": 0.037121184170246124,
      "rmse_dy": 0.011356914415955544,
      "rmse_mean": 0.03515767678618431,
      "rotation_flip": 0.01075268816202879,
      "sparse_tokens": 3014.0,
      "step": 9370,
      "turn_loss": 0.42828986048698425,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4353744657126928,
      "grad_norm": 0.3952760100364685,
      "learning_rate": 1.1612921260354132e-06,
      "loss": 0.1107,
      "mae_dtheta": 0.009287005290389061,
      "mae_dx": 0.0014947092859074473,
      "mae_dy": 0.0016258818795904517,
      "pose_mae_dtheta": 0.06476058810949326,
      "pose_mae_dx": 0.018113674595952034,
      "pose_mae_dy": 0.022486446425318718,
      "pose_rmse_dtheta": 0.16888631880283356,
      "pose_rmse_dx": 0.042559679597616196,
      "pose_rmse_dy": 0.05399545282125473,
      "pose_rmse_mean": 0.08848048746585846,
      "rmse_dtheta": 0.020915139466524124,
      "rmse_dx": 0.004386094398796558,
      "rmse_dy": 0.0034550160635262728,
      "rmse_mean": 0.009585416875779629,
      "rotation_flip": 0.0016771488590165973,
      "sparse_tokens": 32137.0,
      "step": 9371,
      "turn_loss": 0.06747231632471085,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4354209254785356,
      "grad_norm": 0.520087480545044,
      "learning_rate": 1.1604450356560577e-06,
      "loss": 0.0955,
      "mae_dtheta": 0.006477120332419872,
      "mae_dx": 0.0008754731970839202,
      "mae_dy": 0.0010263497242704034,
      "pose_mae_dtheta": 0.04079526290297508,
      "pose_mae_dx": 0.009438668377697468,
      "pose_mae_dy": 0.015480306930840015,
      "pose_rmse_dtheta": 0.12548398971557617,
      "pose_rmse_dx": 0.02881735749542713,
      "pose_rmse_dy": 0.03858631104230881,
      "pose_rmse_mean": 0.06429588794708252,
      "rmse_dtheta": 0.018431413918733597,
      "rmse_dx": 0.003333104308694601,
      "rmse_dy": 0.0022753318771719933,
      "rmse_mean": 0.008013283833861351,
      "rotation_flip": 0.0020242915488779545,
      "sparse_tokens": 32089.0,
      "step": 9372,
      "turn_loss": 0.048388607800006866,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.4354673852443784,
      "grad_norm": 0.5942769050598145,
      "learning_rate": 1.1595982137788403e-06,
      "loss": 0.1467,
      "mae_dtheta": 0.04257063940167427,
      "mae_dx": 0.01006435975432396,
      "mae_dy": 0.007645122706890106,
      "pose_mae_dtheta": 0.33429503440856934,
      "pose_mae_dx": 0.09427521377801895,
      "pose_mae_dy": 0.1086512878537178,
      "pose_rmse_dtheta": 0.4941825270652771,
      "pose_rmse_dx": 0.1848311722278595,
      "pose_rmse_dy": 0.2310396134853363,
      "pose_rmse_mean": 0.30335113406181335,
      "rmse_dtheta": 0.05896110087633133,
      "rmse_dx": 0.02088398113846779,
      "rmse_dy": 0.013573198579251766,
      "rmse_mean": 0.031139429658651352,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 7879.0,
      "step": 9373,
      "turn_loss": 0.3354269862174988,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.43551384501022117,
      "grad_norm": 0.5445061326026917,
      "learning_rate": 1.158751660462983e-06,
      "loss": 0.1678,
      "mae_dtheta": 0.030707091093063354,
      "mae_dx": 0.009433584287762642,
      "mae_dy": 0.008297838270664215,
      "pose_mae_dtheta": 0.23724810779094696,
      "pose_mae_dx": 0.07733545452356339,
      "pose_mae_dy": 0.08003883808851242,
      "pose_rmse_dtheta": 0.43329986929893494,
      "pose_rmse_dx": 0.160870760679245,
      "pose_rmse_dy": 0.16828729212284088,
      "pose_rmse_mean": 0.25415265560150146,
      "rmse_dtheta": 0.0470418706536293,
      "rmse_dx": 0.020321454852819443,
      "rmse_dy": 0.013645860366523266,
      "rmse_mean": 0.027003061026334763,
      "rotation_flip": 0.012024047784507275,
      "sparse_tokens": 8612.0,
      "step": 9374,
      "turn_loss": 0.31902289390563965,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.43556030477606394,
      "grad_norm": 0.43595248460769653,
      "learning_rate": 1.1579053757676817e-06,
      "loss": 0.0875,
      "mae_dtheta": 0.008951335214078426,
      "mae_dx": 0.0011818129569292068,
      "mae_dy": 0.0013847746886312962,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.43595245480537415,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 168.689208984375,
      "model/head/act_norm_mean": 119.91712042297979,
      "model/head/act_norm_min": 66.01924896240234,
      "model/head/act_over_embed": 82.40816783644125,
      "model/head/grad_frac": 0.09563661366701126,
      "model/head/grad_norm": 0.04169301688671112,
      "model/head/grad_zero_frac": 0.00020305393263697624,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7081113873106061,
      "model/head/update_ratio": 0.0007098943460732698,
      "model/head/weight_delta": 9.901815414428711,
      "model/head/weight_delta_rel": 0.17370717227458954,
      "model/head/weight_norm": 58.731300354003906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4227744936943054,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4226830126503096,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226175546646118,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29047172351400424,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07625416666269302,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03324319049715996,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5268577188940092,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001073425984941423,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1389877796173096,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10256051272153854,
      "model/modality_embedder.encoders.pose/weight_norm": 30.9692440032959,
      "model/modality_embedder/grad_frac": 0.07625416666269302,
      "model/modality_embedder/grad_norm": 0.03324319049715996,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5268577188940092,
      "model/modality_embedder/update_ratio": 0.001073425984941423,
      "model/modality_embedder/weight_delta": 3.1389877796173096,
      "model/modality_embedder/weight_delta_rel": 0.10256051272153854,
      "model/modality_embedder/weight_norm": 30.9692440032959,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.03812408447266,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.532607824274493,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.974175453186035,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.859037774734517,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0707169771194458,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.030829239636659622,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011029480956494808,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6981520652770996,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09832228720188141,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95166778564453,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.71649169921875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.50235740339907,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.21199893951416,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.525458764447528,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07126972824335098,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03107021376490593,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010441964259371161,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.42083740234375,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1185004785656929,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.755144119262695,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.74127960205078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.284198633156965,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.258447647094727,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.74995673939757,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06951351463794708,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03030458837747574,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009863096056506038,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7032432556152344,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1243479773402214,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.725229263305664,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.40669250488281,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.9426607343274,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.960214614868164,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.889667422088714,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06911734491586685,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.030131876468658447,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010063361842185259,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1799888610839844,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10867692530155182,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.942157745361328,
      "model/normalizer/grad_frac": 0.2553231120109558,
      "model/normalizer/grad_norm": 0.1113087385892868,
      "model/normalizer/grad_zero_frac": 0.00022571203589905053,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014154160162433982,
      "model/normalizer/weight_delta": 6.695036888122559,
      "model/normalizer/weight_delta_rel": 0.08622819930315018,
      "model/normalizer/weight_norm": 78.64029693603516,
      "pose_mae_dtheta": 0.06318963319063187,
      "pose_mae_dx": 0.015332438983023167,
      "pose_mae_dy": 0.02126145549118519,
      "pose_rmse_dtheta": 0.19930793344974518,
      "pose_rmse_dx": 0.045317478477954865,
      "pose_rmse_dy": 0.054687004536390305,
      "pose_rmse_mean": 0.09977080672979355,
      "rmse_dtheta": 0.024017393589019775,
      "rmse_dx": 0.00427138851955533,
      "rmse_dy": 0.0035295335110276937,
      "rmse_mean": 0.01060610543936491,
      "rotation_flip": 0.0,
      "sparse_tokens": 32057.0,
      "step": 9375,
      "turn_loss": 0.05612228065729141,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4356067645419067,
      "grad_norm": 0.42212939262390137,
      "learning_rate": 1.1570593597521201e-06,
      "loss": 0.1262,
      "mae_dtheta": 0.0136199239641428,
      "mae_dx": 0.0022831717506051064,
      "mae_dy": 0.0036338979844003916,
      "pose_mae_dtheta": 0.0890556275844574,
      "pose_mae_dx": 0.023095576092600822,
      "pose_mae_dy": 0.032780397683382034,
      "pose_rmse_dtheta": 0.2073735147714615,
      "pose_rmse_dx": 0.05591289699077606,
      "pose_rmse_dy": 0.085234634578228,
      "pose_rmse_mean": 0.11617368459701538,
      "rmse_dtheta": 0.027110720053315163,
      "rmse_dx": 0.00645484821870923,
      "rmse_dy": 0.008670128881931305,
      "rmse_mean": 0.014078566804528236,
      "rotation_flip": 0.009999999776482582,
      "sparse_tokens": 32105.0,
      "step": 9376,
      "turn_loss": 0.13051073253154755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4356532243077495,
      "grad_norm": 0.4114765524864197,
      "learning_rate": 1.1562136124754613e-06,
      "loss": 0.0786,
      "mae_dtheta": 0.008581025525927544,
      "mae_dx": 0.0018968485528603196,
      "mae_dy": 0.0026111232582479715,
      "pose_mae_dtheta": 0.054351624101400375,
      "pose_mae_dx": 0.020666591823101044,
      "pose_mae_dy": 0.024485744535923004,
      "pose_rmse_dtheta": 0.13506296277046204,
      "pose_rmse_dx": 0.05150558426976204,
      "pose_rmse_dy": 0.05233854800462723,
      "pose_rmse_mean": 0.07963570207357407,
      "rmse_dtheta": 0.020148396492004395,
      "rmse_dx": 0.005421461071819067,
      "rmse_dy": 0.006169840227812529,
      "rmse_mean": 0.010579898953437805,
      "rotation_flip": 0.013098648749291897,
      "sparse_tokens": 32073.0,
      "step": 9377,
      "turn_loss": 0.07982415705919266,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4356996840735923,
      "grad_norm": 0.3769122064113617,
      "learning_rate": 1.1553681339968465e-06,
      "loss": 0.1156,
      "mae_dtheta": 0.008844267576932907,
      "mae_dx": 0.0019205810967832804,
      "mae_dy": 0.002821605186909437,
      "pose_mae_dtheta": 0.060391005128622055,
      "pose_mae_dx": 0.02580535225570202,
      "pose_mae_dy": 0.025675326585769653,
      "pose_rmse_dtheta": 0.1466725617647171,
      "pose_rmse_dx": 0.06678730994462967,
      "pose_rmse_dy": 0.05685979872941971,
      "pose_rmse_mean": 0.09010656177997589,
      "rmse_dtheta": 0.02059004455804825,
      "rmse_dx": 0.005189760122448206,
      "rmse_dy": 0.006658345460891724,
      "rmse_mean": 0.010812717489898205,
      "rotation_flip": 0.003074557986110449,
      "sparse_tokens": 32121.0,
      "step": 9378,
      "turn_loss": 0.07989928871393204,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.43574614383943505,
      "grad_norm": 0.863403856754303,
      "learning_rate": 1.154522924375403e-06,
      "loss": 0.19,
      "mae_dtheta": 0.008059241808950901,
      "mae_dx": 0.0014248801162466407,
      "mae_dy": 0.0025067462120205164,
      "pose_mae_dtheta": 0.04975757747888565,
      "pose_mae_dx": 0.017247619107365608,
      "pose_mae_dy": 0.019408531486988068,
      "pose_rmse_dtheta": 0.1322862207889557,
      "pose_rmse_dx": 0.049612585455179214,
      "pose_rmse_dy": 0.045421943068504333,
      "pose_rmse_mean": 0.07577358186244965,
      "rmse_dtheta": 0.019040578976273537,
      "rmse_dx": 0.004141888581216335,
      "rmse_dy": 0.006135249976068735,
      "rmse_mean": 0.009772572666406631,
      "rotation_flip": 0.005532503593713045,
      "sparse_tokens": 32073.0,
      "step": 9379,
      "turn_loss": 0.07371960580348969,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.43579260360527783,
      "grad_norm": 0.37596815824508667,
      "learning_rate": 1.1536779836702338e-06,
      "loss": 0.0572,
      "mae_dtheta": 0.007501213811337948,
      "mae_dx": 0.0010640942491590977,
      "mae_dy": 0.0021000076085329056,
      "pose_mae_dtheta": 0.0485728457570076,
      "pose_mae_dx": 0.016736507415771484,
      "pose_mae_dy": 0.024909449741244316,
      "pose_rmse_dtheta": 0.10272203385829926,
      "pose_rmse_dx": 0.04090427607297897,
      "pose_rmse_dy": 0.0619957372546196,
      "pose_rmse_mean": 0.06854068487882614,
      "rmse_dtheta": 0.016169192269444466,
      "rmse_dx": 0.0030181393958628178,
      "rmse_dy": 0.004666730761528015,
      "rmse_mean": 0.00795135460793972,
      "rotation_flip": 0.003960396163165569,
      "sparse_tokens": 32073.0,
      "step": 9380,
      "turn_loss": 0.06175555661320686,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4358390633711206,
      "grad_norm": 0.5660431385040283,
      "learning_rate": 1.152833311940429e-06,
      "loss": 0.0905,
      "mae_dtheta": 0.007656775880604982,
      "mae_dx": 0.0024239816702902317,
      "mae_dy": 0.0015253543388098478,
      "pose_mae_dtheta": 0.05687772110104561,
      "pose_mae_dx": 0.023241249844431877,
      "pose_mae_dy": 0.016145529225468636,
      "pose_rmse_dtheta": 0.1985745131969452,
      "pose_rmse_dx": 0.0752306878566742,
      "pose_rmse_dy": 0.054584525525569916,
      "pose_rmse_mean": 0.10946324467658997,
      "rmse_dtheta": 0.023321662098169327,
      "rmse_dx": 0.008402954787015915,
      "rmse_dy": 0.004900421481579542,
      "rmse_mean": 0.012208346277475357,
      "rotation_flip": 0.003929273225367069,
      "sparse_tokens": 32073.0,
      "step": 9381,
      "turn_loss": 0.06275557726621628,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4358855231369634,
      "grad_norm": 0.3603023588657379,
      "learning_rate": 1.1519889092450543e-06,
      "loss": 0.0781,
      "mae_dtheta": 0.009732162579894066,
      "mae_dx": 0.0015032825758680701,
      "mae_dy": 0.002126128878444433,
      "pose_mae_dtheta": 0.06071803346276283,
      "pose_mae_dx": 0.018837084993720055,
      "pose_mae_dy": 0.025824837386608124,
      "pose_rmse_dtheta": 0.14155274629592896,
      "pose_rmse_dx": 0.05325135588645935,
      "pose_rmse_dy": 0.07194716483354568,
      "pose_rmse_mean": 0.0889170914888382,
      "rmse_dtheta": 0.021642761304974556,
      "rmse_dx": 0.00552997924387455,
      "rmse_dy": 0.005770185962319374,
      "rmse_mean": 0.01098097674548626,
      "rotation_flip": 0.004895960912108421,
      "sparse_tokens": 32105.0,
      "step": 9382,
      "turn_loss": 0.07373733818531036,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5855.0,
      "epoch": 0.43593198290280616,
      "grad_norm": 0.7204725742340088,
      "learning_rate": 1.1511447756431604e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.03291688859462738,
      "mae_dx": 0.011443756520748138,
      "mae_dy": 0.002543622860684991,
      "pose_mae_dtheta": 0.29883596301078796,
      "pose_mae_dx": 0.10327234864234924,
      "pose_mae_dy": 0.034826960414648056,
      "pose_rmse_dtheta": 0.5664170384407043,
      "pose_rmse_dx": 0.2233905792236328,
      "pose_rmse_dy": 0.08250325173139572,
      "pose_rmse_mean": 0.2907702922821045,
      "rmse_dtheta": 0.05573641136288643,
      "rmse_dx": 0.02353624999523163,
      "rmse_dy": 0.0048799337819218636,
      "rmse_mean": 0.028050865978002548,
      "rotation_flip": 0.008163264952600002,
      "sparse_tokens": 4791.0,
      "step": 9383,
      "turn_loss": 0.20920026302337646,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.43597844266864894,
      "grad_norm": 0.6569092869758606,
      "learning_rate": 1.1503009111937802e-06,
      "loss": 0.1376,
      "mae_dtheta": 0.043509550392627716,
      "mae_dx": 0.018102405592799187,
      "mae_dy": 0.011994353495538235,
      "pose_mae_dtheta": 0.35979369282722473,
      "pose_mae_dx": 0.11935053765773773,
      "pose_mae_dy": 0.06920882314443588,
      "pose_rmse_dtheta": 0.5576033592224121,
      "pose_rmse_dx": 0.23041890561580658,
      "pose_rmse_dy": 0.12593795359134674,
      "pose_rmse_mean": 0.3046534061431885,
      "rmse_dtheta": 0.06056445091962814,
      "rmse_dx": 0.030178522691130638,
      "rmse_dy": 0.024038759991526604,
      "rmse_mean": 0.038260579109191895,
      "rotation_flip": 0.036363635212183,
      "sparse_tokens": 4510.0,
      "step": 9384,
      "turn_loss": 0.4502812623977661,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.4360249024344917,
      "grad_norm": 0.4418947696685791,
      "learning_rate": 1.1494573159559214e-06,
      "loss": 0.1034,
      "mae_dtheta": 0.03407490253448486,
      "mae_dx": 0.009739222005009651,
      "mae_dy": 0.004766935016959906,
      "pose_mae_dtheta": 0.2683444619178772,
      "pose_mae_dx": 0.08678046613931656,
      "pose_mae_dy": 0.06518886238336563,
      "pose_rmse_dtheta": 0.4675167500972748,
      "pose_rmse_dx": 0.18244534730911255,
      "pose_rmse_dy": 0.14428403973579407,
      "pose_rmse_mean": 0.2647486925125122,
      "rmse_dtheta": 0.05271093547344208,
      "rmse_dx": 0.01995592564344406,
      "rmse_dy": 0.008400408551096916,
      "rmse_mean": 0.027022425085306168,
      "rotation_flip": 0.020654045045375824,
      "sparse_tokens": 10311.0,
      "step": 9385,
      "turn_loss": 0.22929136455059052,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4360713622003345,
      "grad_norm": 0.3059540390968323,
      "learning_rate": 1.1486139899885805e-06,
      "loss": 0.0674,
      "mae_dtheta": 0.006585221737623215,
      "mae_dx": 0.001285314909182489,
      "mae_dy": 0.001261543482542038,
      "pose_mae_dtheta": 0.04372391849756241,
      "pose_mae_dx": 0.013493612408638,
      "pose_mae_dy": 0.01752546802163124,
      "pose_rmse_dtheta": 0.12235798686742783,
      "pose_rmse_dx": 0.04589346423745155,
      "pose_rmse_dy": 0.048247601836919785,
      "pose_rmse_mean": 0.07216635346412659,
      "rmse_dtheta": 0.016370117664337158,
      "rmse_dx": 0.00493776798248291,
      "rmse_dy": 0.0028070334810763597,
      "rmse_mean": 0.00803830660879612,
      "rotation_flip": 0.0027173913549631834,
      "sparse_tokens": 32073.0,
      "step": 9386,
      "turn_loss": 0.0522441528737545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.43611782196617727,
      "grad_norm": 0.8728517293930054,
      "learning_rate": 1.1477709333507298e-06,
      "loss": 0.2509,
      "mae_dtheta": 0.02682877518236637,
      "mae_dx": 0.007547684013843536,
      "mae_dy": 0.0037366102915257215,
      "pose_mae_dtheta": 0.19955787062644958,
      "pose_mae_dx": 0.0561443567276001,
      "pose_mae_dy": 0.051898419857025146,
      "pose_rmse_dtheta": 0.341919481754303,
      "pose_rmse_dx": 0.11741119623184204,
      "pose_rmse_dy": 0.10890524089336395,
      "pose_rmse_mean": 0.1894119828939438,
      "rmse_dtheta": 0.04243983328342438,
      "rmse_dx": 0.016577163711190224,
      "rmse_dy": 0.006376418750733137,
      "rmse_mean": 0.021797804161906242,
      "rotation_flip": 0.01901140622794628,
      "sparse_tokens": 8288.0,
      "step": 9387,
      "turn_loss": 0.20337894558906555,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.4361642817320201,
      "grad_norm": 0.6805047392845154,
      "learning_rate": 1.1469281461013248e-06,
      "loss": 0.1591,
      "mae_dtheta": 0.039400067180395126,
      "mae_dx": 0.009574747644364834,
      "mae_dy": 0.004054253455251455,
      "pose_mae_dtheta": 0.314947247505188,
      "pose_mae_dx": 0.08178631216287613,
      "pose_mae_dy": 0.04569484293460846,
      "pose_rmse_dtheta": 0.574779748916626,
      "pose_rmse_dx": 0.19135819375514984,
      "pose_rmse_dy": 0.09572415053844452,
      "pose_rmse_mean": 0.2872873842716217,
      "rmse_dtheta": 0.05940075218677521,
      "rmse_dx": 0.020611850544810295,
      "rmse_dy": 0.008234192617237568,
      "rmse_mean": 0.02941560000181198,
      "rotation_flip": 0.01827676221728325,
      "sparse_tokens": 12447.0,
      "step": 9388,
      "turn_loss": 0.2556883990764618,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.4362107414978629,
      "grad_norm": 0.81024169921875,
      "learning_rate": 1.1460856282993043e-06,
      "loss": 0.1944,
      "mae_dtheta": 0.022173859179019928,
      "mae_dx": 0.0035510235466063023,
      "mae_dy": 0.0023921604733914137,
      "pose_mae_dtheta": 0.15014640986919403,
      "pose_mae_dx": 0.030644288286566734,
      "pose_mae_dy": 0.014751061797142029,
      "pose_rmse_dtheta": 0.2758956551551819,
      "pose_rmse_dx": 0.08852169662714005,
      "pose_rmse_dy": 0.030472228303551674,
      "pose_rmse_mean": 0.1316298544406891,
      "rmse_dtheta": 0.03979404270648956,
      "rmse_dx": 0.009538691490888596,
      "rmse_dy": 0.005390964914113283,
      "rmse_mean": 0.018241234123706818,
      "rotation_flip": 0.00749063678085804,
      "sparse_tokens": 4500.0,
      "step": 9389,
      "turn_loss": 0.12155715376138687,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.43625720126370565,
      "grad_norm": 0.6357888579368591,
      "learning_rate": 1.1452433800035845e-06,
      "loss": 0.1552,
      "mae_dtheta": 0.033957917243242264,
      "mae_dx": 0.01239398866891861,
      "mae_dy": 0.006739059928804636,
      "pose_mae_dtheta": 0.2391834855079651,
      "pose_mae_dx": 0.10238835215568542,
      "pose_mae_dy": 0.0721263512969017,
      "pose_rmse_dtheta": 0.4002438485622406,
      "pose_rmse_dx": 0.22107191383838654,
      "pose_rmse_dy": 0.13639119267463684,
      "pose_rmse_mean": 0.2525690197944641,
      "rmse_dtheta": 0.04884142801165581,
      "rmse_dx": 0.024695182219147682,
      "rmse_dy": 0.011510560289025307,
      "rmse_mean": 0.028349056839942932,
      "rotation_flip": 0.010430247522890568,
      "sparse_tokens": 12584.0,
      "step": 9390,
      "turn_loss": 0.3269779682159424,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.43630366102954843,
      "grad_norm": 0.3481579124927521,
      "learning_rate": 1.144401401273062e-06,
      "loss": 0.0859,
      "mae_dtheta": 0.005155955441296101,
      "mae_dx": 0.0009102527983486652,
      "mae_dy": 0.0009714247426018119,
      "pose_mae_dtheta": 0.033342067152261734,
      "pose_mae_dx": 0.008945413865149021,
      "pose_mae_dy": 0.014238853938877583,
      "pose_rmse_dtheta": 0.07834652811288834,
      "pose_rmse_dx": 0.026069559156894684,
      "pose_rmse_dy": 0.035796523094177246,
      "pose_rmse_mean": 0.046737536787986755,
      "rmse_dtheta": 0.012301917187869549,
      "rmse_dx": 0.0031057698652148247,
      "rmse_dy": 0.0023059998638927937,
      "rmse_mean": 0.005904562305659056,
      "rotation_flip": 0.0032858706545084715,
      "sparse_tokens": 32089.0,
      "step": 9391,
      "turn_loss": 0.042639315128326416,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.4363501207953912,
      "grad_norm": 0.7813984155654907,
      "learning_rate": 1.143559692166621e-06,
      "loss": 0.1944,
      "mae_dtheta": 0.035798802971839905,
      "mae_dx": 0.009431001730263233,
      "mae_dy": 0.007368138991296291,
      "pose_mae_dtheta": 0.2846386134624481,
      "pose_mae_dx": 0.08467525243759155,
      "pose_mae_dy": 0.06611897796392441,
      "pose_rmse_dtheta": 0.49407660961151123,
      "pose_rmse_dx": 0.1954764574766159,
      "pose_rmse_dy": 0.16841340065002441,
      "pose_rmse_mean": 0.28598883748054504,
      "rmse_dtheta": 0.0558372400701046,
      "rmse_dx": 0.01997598074376583,
      "rmse_dy": 0.016092685982584953,
      "rmse_mean": 0.030635302886366844,
      "rotation_flip": 0.015810277312994003,
      "sparse_tokens": 20446.0,
      "step": 9392,
      "turn_loss": 0.31646010279655457,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.436396580561234,
      "grad_norm": 0.562014102935791,
      "learning_rate": 1.1427182527431192e-06,
      "loss": 0.1313,
      "mae_dtheta": 0.03844501078128815,
      "mae_dx": 0.027544762939214706,
      "mae_dy": 0.0038474679458886385,
      "pose_mae_dtheta": 0.3233671188354492,
      "pose_mae_dx": 0.25537779927253723,
      "pose_mae_dy": 0.052426863461732864,
      "pose_rmse_dtheta": 0.4817025363445282,
      "pose_rmse_dx": 0.4567258358001709,
      "pose_rmse_dy": 0.11417162418365479,
      "pose_rmse_mean": 0.3508666753768921,
      "rmse_dtheta": 0.05080873891711235,
      "rmse_dx": 0.042290788143873215,
      "rmse_dy": 0.006162029225379229,
      "rmse_mean": 0.03308718651533127,
      "rotation_flip": 0.0051282052882015705,
      "sparse_tokens": 3666.0,
      "step": 9393,
      "turn_loss": 0.1786542683839798,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.43644304032707676,
      "grad_norm": 0.36137139797210693,
      "learning_rate": 1.1418770830614012e-06,
      "loss": 0.0917,
      "mae_dtheta": 0.008015776053071022,
      "mae_dx": 0.0015999418683350086,
      "mae_dy": 0.0019427848747000098,
      "pose_mae_dtheta": 0.05979131534695625,
      "pose_mae_dx": 0.01639261282980442,
      "pose_mae_dy": 0.0222591795027256,
      "pose_rmse_dtheta": 0.17021286487579346,
      "pose_rmse_dx": 0.043525002896785736,
      "pose_rmse_dy": 0.05696146562695503,
      "pose_rmse_mean": 0.09023311734199524,
      "rmse_dtheta": 0.020970698446035385,
      "rmse_dx": 0.006004564464092255,
      "rmse_dy": 0.005899746436625719,
      "rmse_mean": 0.010958336293697357,
      "rotation_flip": 0.0023331777192652225,
      "sparse_tokens": 32073.0,
      "step": 9394,
      "turn_loss": 0.07358960807323456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.43648950009291954,
      "grad_norm": 2.0698254108428955,
      "learning_rate": 1.1410361831802885e-06,
      "loss": 0.2306,
      "mae_dtheta": 0.04269879683852196,
      "mae_dx": 0.010862832888960838,
      "mae_dy": 0.008088131435215473,
      "pose_mae_dtheta": 0.349922776222229,
      "pose_mae_dx": 0.07412443310022354,
      "pose_mae_dy": 0.0867314338684082,
      "pose_rmse_dtheta": 0.6206673979759216,
      "pose_rmse_dx": 0.1926030069589615,
      "pose_rmse_dy": 0.2657950222492218,
      "pose_rmse_mean": 0.35968849062919617,
      "rmse_dtheta": 0.06530175358057022,
      "rmse_dx": 0.02363605797290802,
      "rmse_dy": 0.017171720042824745,
      "rmse_mean": 0.03536984324455261,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 5410.0,
      "step": 9395,
      "turn_loss": 0.31837695837020874,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.4365359598587623,
      "grad_norm": 0.30249160528182983,
      "learning_rate": 1.1401955531585878e-06,
      "loss": 0.092,
      "mae_dtheta": 0.03399094566702843,
      "mae_dx": 0.010508923791348934,
      "mae_dy": 0.008720768615603447,
      "pose_mae_dtheta": 0.2549535930156708,
      "pose_mae_dx": 0.09005451202392578,
      "pose_mae_dy": 0.08645160496234894,
      "pose_rmse_dtheta": 0.4410611689090729,
      "pose_rmse_dx": 0.17923372983932495,
      "pose_rmse_dy": 0.207246333360672,
      "pose_rmse_mean": 0.27584707736968994,
      "rmse_dtheta": 0.05264074727892876,
      "rmse_dx": 0.021068831905722618,
      "rmse_dy": 0.019557055085897446,
      "rmse_mean": 0.031088879331946373,
      "rotation_flip": 0.014851485379040241,
      "sparse_tokens": 19999.0,
      "step": 9396,
      "turn_loss": 0.33174240589141846,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4365824196246051,
      "grad_norm": 0.3845055103302002,
      "learning_rate": 1.1393551930550828e-06,
      "loss": 0.0761,
      "mae_dtheta": 0.011950744315981865,
      "mae_dx": 0.0021541982423514128,
      "mae_dy": 0.003043664153665304,
      "pose_mae_dtheta": 0.078257255256176,
      "pose_mae_dx": 0.020875556394457817,
      "pose_mae_dy": 0.02705850638449192,
      "pose_rmse_dtheta": 0.24331316351890564,
      "pose_rmse_dx": 0.06394244730472565,
      "pose_rmse_dy": 0.06941447407007217,
      "pose_rmse_mean": 0.12555670738220215,
      "rmse_dtheta": 0.02875218354165554,
      "rmse_dx": 0.008195769973099232,
      "rmse_dy": 0.01017135102301836,
      "rmse_mean": 0.015706434845924377,
      "rotation_flip": 0.004225893411785364,
      "sparse_tokens": 32105.0,
      "step": 9397,
      "turn_loss": 0.11306411772966385,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24338.0,
      "epoch": 0.43662887939044787,
      "grad_norm": 0.48045384883880615,
      "learning_rate": 1.1385151029285424e-06,
      "loss": 0.0941,
      "mae_dtheta": 0.028995495289564133,
      "mae_dx": 0.009488148614764214,
      "mae_dy": 0.004337348975241184,
      "pose_mae_dtheta": 0.23285320401191711,
      "pose_mae_dx": 0.07133392244577408,
      "pose_mae_dy": 0.0605752132833004,
      "pose_rmse_dtheta": 0.4288918375968933,
      "pose_rmse_dx": 0.17035527527332306,
      "pose_rmse_dy": 0.15132160484790802,
      "pose_rmse_mean": 0.25018957257270813,
      "rmse_dtheta": 0.04638771712779999,
      "rmse_dx": 0.02135893888771534,
      "rmse_dy": 0.00868996325880289,
      "rmse_mean": 0.025478873401880264,
      "rotation_flip": 0.012544803321361542,
      "sparse_tokens": 20416.0,
      "step": 9398,
      "turn_loss": 0.22448882460594177,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 24910.0,
      "epoch": 0.43667533915629064,
      "grad_norm": 0.5586180090904236,
      "learning_rate": 1.1376752828377125e-06,
      "loss": 0.2046,
      "mae_dtheta": 0.04457063227891922,
      "mae_dx": 0.0156790092587471,
      "mae_dy": 0.008276809006929398,
      "pose_mae_dtheta": 0.34162792563438416,
      "pose_mae_dx": 0.11675995588302612,
      "pose_mae_dy": 0.08517000079154968,
      "pose_rmse_dtheta": 0.5543826222419739,
      "pose_rmse_dx": 0.22907105088233948,
      "pose_rmse_dy": 0.20450608432292938,
      "pose_rmse_mean": 0.32931995391845703,
      "rmse_dtheta": 0.062016334384679794,
      "rmse_dx": 0.028511669486761093,
      "rmse_dy": 0.01686100848019123,
      "rmse_mean": 0.03579633682966232,
      "rotation_flip": 0.014574898406863213,
      "sparse_tokens": 19011.0,
      "step": 9399,
      "turn_loss": 0.4231830835342407,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.4367217989221334,
      "grad_norm": 1.1680876016616821,
      "learning_rate": 1.1368357328413242e-06,
      "loss": 0.2785,
      "mae_dtheta": 0.03389269486069679,
      "mae_dx": 0.011673327535390854,
      "mae_dy": 0.005490233656018972,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999993443489075,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 135.50918579101562,
      "model/head/act_norm_mean": 106.16765030570652,
      "model/head/act_norm_min": 74.5108642578125,
      "model/head/act_over_embed": 72.95940324728373,
      "model/head/grad_frac": 0.11287221312522888,
      "model/head/grad_norm": 0.11287213861942291,
      "model/head/grad_zero_frac": 0.0001250050845555961,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7010869565217391,
      "model/head/update_ratio": 0.0019218283705413342,
      "model/head/weight_delta": 9.904292106628418,
      "model/head/weight_delta_rel": 0.1737506240606308,
      "model/head/weight_norm": 58.73164367675781,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4226759374141693,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4226759374141693,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226759374141693,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904668613454892,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07854760438203812,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07854755222797394,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0025363112799823284,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1405651569366455,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10261204838752747,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969207763671875,
      "model/modality_embedder/grad_frac": 0.07854760438203812,
      "model/modality_embedder/grad_norm": 0.07854755222797394,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0025363112799823284,
      "model/modality_embedder/weight_delta": 3.1405651569366455,
      "model/modality_embedder/weight_delta_rel": 0.10261204838752747,
      "model/modality_embedder/weight_norm": 30.969207763671875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.2229995727539,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.273890398550726,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.104576110839844,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.99403537547894,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06997141987085342,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06997137516736984,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002503273542970419,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.6994171142578125,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09836839139461517,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.951950073242188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.49713134765625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.067481884057973,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.799263000488281,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.539398874040064,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07173940539360046,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07173936069011688,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0024109557271003723,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.422537326812744,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11855936795473099,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.755569458007812,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 73.7684326171875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.72470238095238,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.207015991210938,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.67825631464864,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06859470158815384,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06859465688467026,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0022324756719172,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7050492763519287,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12440861761569977,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.725826263427734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.26042175292969,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.56555706521739,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.009864807128906,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.94330888802864,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06553555279970169,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06553550809621811,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002188700484111905,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1816089153289795,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10873229056596756,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.942655563354492,
      "model/normalizer/grad_frac": 0.25310638546943665,
      "model/normalizer/grad_norm": 0.2531062066555023,
      "model/normalizer/grad_zero_frac": 0.00017489728634245694,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0032185076270252466,
      "model/normalizer/weight_delta": 6.698302745819092,
      "model/normalizer/weight_delta_rel": 0.08627025783061981,
      "model/normalizer/weight_norm": 78.64086151123047,
      "pose_mae_dtheta": 0.27467530965805054,
      "pose_mae_dx": 0.07964295893907547,
      "pose_mae_dy": 0.07409016788005829,
      "pose_rmse_dtheta": 0.45039358735084534,
      "pose_rmse_dx": 0.19983677566051483,
      "pose_rmse_dy": 0.1701040267944336,
      "pose_rmse_mean": 0.273444801568985,
      "rmse_dtheta": 0.051555484533309937,
      "rmse_dx": 0.024652600288391113,
      "rmse_dy": 0.00938176829367876,
      "rmse_mean": 0.028529953211545944,
      "rotation_flip": 0.018018018454313278,
      "sparse_tokens": 6454.0,
      "step": 9400,
      "turn_loss": 0.26301413774490356,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "epoch": 0.4367217989221334,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30008459091186523,
      "eval_objectnav_nopose_mae_dtheta": 0.040190041065216064,
      "eval_objectnav_nopose_mae_dx": 0.01351919211447239,
      "eval_objectnav_nopose_mae_dy": 0.005084952339529991,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3234829306602478,
      "eval_objectnav_nopose_pose_mae_dx": 0.10870619118213654,
      "eval_objectnav_nopose_pose_mae_dy": 0.05665184557437897,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5445244312286377,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23712991178035736,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1313171684741974,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30432385206222534,
      "eval_objectnav_nopose_rmse_dtheta": 0.05809547379612923,
      "eval_objectnav_nopose_rmse_dx": 0.026282217353582382,
      "eval_objectnav_nopose_rmse_dy": 0.010162785649299622,
      "eval_objectnav_nopose_rmse_mean": 0.03151349350810051,
      "eval_objectnav_nopose_rotation_flip": 0.016846202313899994,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30008459091186523,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 9400
    },
    {
      "epoch": 0.4367217989221334,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2712770998477936,
      "eval_objectnav_pose_mae_dtheta": 0.03510287031531334,
      "eval_objectnav_pose_mae_dx": 0.010838251560926437,
      "eval_objectnav_pose_mae_dy": 0.004797688685357571,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2635730803012848,
      "eval_objectnav_pose_pose_mae_dx": 0.08532951772212982,
      "eval_objectnav_pose_pose_mae_dy": 0.04993854835629463,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4603196978569031,
      "eval_objectnav_pose_pose_rmse_dx": 0.19712409377098083,
      "eval_objectnav_pose_pose_rmse_dy": 0.12021014839410782,
      "eval_objectnav_pose_pose_rmse_mean": 0.2592179775238037,
      "eval_objectnav_pose_rmse_dtheta": 0.052737753838300705,
      "eval_objectnav_pose_rmse_dx": 0.02278986945748329,
      "eval_objectnav_pose_rmse_dy": 0.009983004070818424,
      "eval_objectnav_pose_rmse_mean": 0.028503542765975,
      "eval_objectnav_pose_rotation_flip": 0.016308944672346115,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2712770998477936,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 9400
    },
    {
      "epoch": 0.4367217989221334,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08787668496370316,
      "eval_pointnav_mae_dtheta": 0.010162526741623878,
      "eval_pointnav_mae_dx": 0.0022246376611292362,
      "eval_pointnav_mae_dy": 0.0023582596331834793,
      "eval_pointnav_pose_mae_dtheta": 0.06967128813266754,
      "eval_pointnav_pose_mae_dx": 0.02468573860824108,
      "eval_pointnav_pose_mae_dy": 0.025475436821579933,
      "eval_pointnav_pose_rmse_dtheta": 0.20166462659835815,
      "eval_pointnav_pose_rmse_dx": 0.07816041260957718,
      "eval_pointnav_pose_rmse_dy": 0.07537208497524261,
      "eval_pointnav_pose_rmse_mean": 0.11839904636144638,
      "eval_pointnav_rmse_dtheta": 0.025302540510892868,
      "eval_pointnav_rmse_dx": 0.007234945427626371,
      "eval_pointnav_rmse_dy": 0.006374165881425142,
      "eval_pointnav_rmse_mean": 0.012970550917088985,
      "eval_pointnav_rotation_flip": 0.005347439553588629,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08787668496370316,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 9400
    },
    {
      "epoch": 0.4367217989221334,
      "eval_loss": 0.21974612524112067,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30008459091186523,
      "eval_objectnav_nopose_mae_dtheta": 0.040190041065216064,
      "eval_objectnav_nopose_mae_dx": 0.01351919211447239,
      "eval_objectnav_nopose_mae_dy": 0.005084952339529991,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3234829306602478,
      "eval_objectnav_nopose_pose_mae_dx": 0.10870619118213654,
      "eval_objectnav_nopose_pose_mae_dy": 0.05665184557437897,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5445244312286377,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23712991178035736,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1313171684741974,
      "eval_objectnav_nopose_pose_rmse_mean": 0.30432385206222534,
      "eval_objectnav_nopose_rmse_dtheta": 0.05809547379612923,
      "eval_objectnav_nopose_rmse_dx": 0.026282217353582382,
      "eval_objectnav_nopose_rmse_dy": 0.010162785649299622,
      "eval_objectnav_nopose_rmse_mean": 0.03151349350810051,
      "eval_objectnav_nopose_rotation_flip": 0.016846202313899994,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30008459091186523,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2712770998477936,
      "eval_objectnav_pose_mae_dtheta": 0.03510287031531334,
      "eval_objectnav_pose_mae_dx": 0.010838251560926437,
      "eval_objectnav_pose_mae_dy": 0.004797688685357571,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2635730803012848,
      "eval_objectnav_pose_pose_mae_dx": 0.08532951772212982,
      "eval_objectnav_pose_pose_mae_dy": 0.04993854835629463,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4603196978569031,
      "eval_objectnav_pose_pose_rmse_dx": 0.19712409377098083,
      "eval_objectnav_pose_pose_rmse_dy": 0.12021014839410782,
      "eval_objectnav_pose_pose_rmse_mean": 0.2592179775238037,
      "eval_objectnav_pose_rmse_dtheta": 0.052737753838300705,
      "eval_objectnav_pose_rmse_dx": 0.02278986945748329,
      "eval_objectnav_pose_rmse_dy": 0.009983004070818424,
      "eval_objectnav_pose_rmse_mean": 0.028503542765975,
      "eval_objectnav_pose_rotation_flip": 0.016308944672346115,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2712770998477936,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08787668496370316,
      "eval_pointnav_mae_dtheta": 0.010162526741623878,
      "eval_pointnav_mae_dx": 0.0022246376611292362,
      "eval_pointnav_mae_dy": 0.0023582596331834793,
      "eval_pointnav_pose_mae_dtheta": 0.06967128813266754,
      "eval_pointnav_pose_mae_dx": 0.02468573860824108,
      "eval_pointnav_pose_mae_dy": 0.025475436821579933,
      "eval_pointnav_pose_rmse_dtheta": 0.20166462659835815,
      "eval_pointnav_pose_rmse_dx": 0.07816041260957718,
      "eval_pointnav_pose_rmse_dy": 0.07537208497524261,
      "eval_pointnav_pose_rmse_mean": 0.11839904636144638,
      "eval_pointnav_rmse_dtheta": 0.025302540510892868,
      "eval_pointnav_rmse_dx": 0.007234945427626371,
      "eval_pointnav_rmse_dy": 0.006374165881425142,
      "eval_pointnav_rmse_mean": 0.012970550917088985,
      "eval_pointnav_rotation_flip": 0.005347439553588629,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08787668496370316,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 9400
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4367682586879762,
      "grad_norm": 0.6167307496070862,
      "learning_rate": 1.135996452998085e-06,
      "loss": 0.1294,
      "mae_dtheta": 0.012777050025761127,
      "mae_dx": 0.0026972780469805002,
      "mae_dy": 0.003249860368669033,
      "pose_mae_dtheta": 0.0948249027132988,
      "pose_mae_dx": 0.034265827387571335,
      "pose_mae_dy": 0.04143136367201805,
      "pose_rmse_dtheta": 0.25587227940559387,
      "pose_rmse_dx": 0.097613126039505,
      "pose_rmse_dy": 0.1349124312400818,
      "pose_rmse_mean": 0.16279928386211395,
      "rmse_dtheta": 0.028945760801434517,
      "rmse_dx": 0.007811413612216711,
      "rmse_dy": 0.01019707415252924,
      "rmse_mean": 0.015651416033506393,
      "rotation_flip": 0.006718346383422613,
      "sparse_tokens": 32073.0,
      "step": 9401,
      "turn_loss": 0.1126830205321312,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.436814718453819,
      "grad_norm": 0.4861036539077759,
      "learning_rate": 1.1351574433666878e-06,
      "loss": 0.0979,
      "mae_dtheta": 0.008094990625977516,
      "mae_dx": 0.001747150789014995,
      "mae_dy": 0.003014596411958337,
      "pose_mae_dtheta": 0.05570884048938751,
      "pose_mae_dx": 0.026313401758670807,
      "pose_mae_dy": 0.029541581869125366,
      "pose_rmse_dtheta": 0.11792845278978348,
      "pose_rmse_dx": 0.06165768951177597,
      "pose_rmse_dy": 0.059259023517370224,
      "pose_rmse_mean": 0.07961505651473999,
      "rmse_dtheta": 0.016402285546064377,
      "rmse_dx": 0.004507108125835657,
      "rmse_dy": 0.006653896998614073,
      "rmse_mean": 0.009187763556838036,
      "rotation_flip": 0.0032028469722718,
      "sparse_tokens": 32089.0,
      "step": 9402,
      "turn_loss": 0.07879101485013962,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.43686117821966175,
      "grad_norm": 0.724031925201416,
      "learning_rate": 1.1343187040058068e-06,
      "loss": 0.0828,
      "mae_dtheta": 0.03766856715083122,
      "mae_dx": 0.010226321406662464,
      "mae_dy": 0.0048174140974879265,
      "pose_mae_dtheta": 0.2719329595565796,
      "pose_mae_dx": 0.07229208201169968,
      "pose_mae_dy": 0.0500834658741951,
      "pose_rmse_dtheta": 0.5288941860198975,
      "pose_rmse_dx": 0.1717277616262436,
      "pose_rmse_dy": 0.1311488002538681,
      "pose_rmse_mean": 0.27725693583488464,
      "rmse_dtheta": 0.05851537734270096,
      "rmse_dx": 0.02177167311310768,
      "rmse_dy": 0.00952788908034563,
      "rmse_mean": 0.029938315972685814,
      "rotation_flip": 0.009259259328246117,
      "sparse_tokens": 9171.0,
      "step": 9403,
      "turn_loss": 0.2634326219558716,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4369076379855045,
      "grad_norm": 0.5632038712501526,
      "learning_rate": 1.133480234974092e-06,
      "loss": 0.1582,
      "mae_dtheta": 0.010103676468133926,
      "mae_dx": 0.001398945925757289,
      "mae_dy": 0.0018821714911609888,
      "pose_mae_dtheta": 0.07028528302907944,
      "pose_mae_dx": 0.0169929638504982,
      "pose_mae_dy": 0.022140460088849068,
      "pose_rmse_dtheta": 0.21698707342147827,
      "pose_rmse_dx": 0.042133551090955734,
      "pose_rmse_dy": 0.05391073599457741,
      "pose_rmse_mean": 0.10434378683567047,
      "rmse_dtheta": 0.024982362985610962,
      "rmse_dx": 0.003762297099456191,
      "rmse_dy": 0.004081222228705883,
      "rmse_mean": 0.010941961780190468,
      "rotation_flip": 0.0029651594813913107,
      "sparse_tokens": 32169.0,
      "step": 9404,
      "turn_loss": 0.06602104008197784,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.43695409775134736,
      "grad_norm": 0.6932873129844666,
      "learning_rate": 1.132642036330181e-06,
      "loss": 0.1588,
      "mae_dtheta": 0.007342339493334293,
      "mae_dx": 0.0008620015578344464,
      "mae_dy": 0.0005582363228313625,
      "pose_mae_dtheta": 0.054566267877817154,
      "pose_mae_dx": 0.007439970038831234,
      "pose_mae_dy": 0.010198641568422318,
      "pose_rmse_dtheta": 0.23875726759433746,
      "pose_rmse_dx": 0.019788306206464767,
      "pose_rmse_dy": 0.03243611752986908,
      "pose_rmse_mean": 0.09699390828609467,
      "rmse_dtheta": 0.02638346143066883,
      "rmse_dx": 0.0029702535830438137,
      "rmse_dy": 0.001352578983642161,
      "rmse_mean": 0.010235431604087353,
      "rotation_flip": 0.0013097577029839158,
      "sparse_tokens": 32121.0,
      "step": 9405,
      "turn_loss": 0.03939905762672424,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.43700055751719014,
      "grad_norm": 0.4875395894050598,
      "learning_rate": 1.1318041081326868e-06,
      "loss": 0.0985,
      "mae_dtheta": 0.010083395056426525,
      "mae_dx": 0.0015743521507829428,
      "mae_dy": 0.0024219502229243517,
      "pose_mae_dtheta": 0.06484752148389816,
      "pose_mae_dx": 0.020513052120804787,
      "pose_mae_dy": 0.02602362632751465,
      "pose_rmse_dtheta": 0.1773161143064499,
      "pose_rmse_dx": 0.05301540717482567,
      "pose_rmse_dy": 0.06058347597718239,
      "pose_rmse_mean": 0.09697167575359344,
      "rmse_dtheta": 0.02260660007596016,
      "rmse_dx": 0.00472783949226141,
      "rmse_dy": 0.005338676739484072,
      "rmse_mean": 0.010891038924455643,
      "rotation_flip": 0.005271695088595152,
      "sparse_tokens": 32089.0,
      "step": 9406,
      "turn_loss": 0.0912243202328682,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.4370470172830329,
      "grad_norm": 0.2898109555244446,
      "learning_rate": 1.130966450440209e-06,
      "loss": 0.0824,
      "mae_dtheta": 0.031953148543834686,
      "mae_dx": 0.008849062025547028,
      "mae_dy": 0.005134635604918003,
      "pose_mae_dtheta": 0.23710381984710693,
      "pose_mae_dx": 0.06466410309076309,
      "pose_mae_dy": 0.04054686427116394,
      "pose_rmse_dtheta": 0.4687555432319641,
      "pose_rmse_dx": 0.1663876324892044,
      "pose_rmse_dy": 0.1137666255235672,
      "pose_rmse_mean": 0.24963659048080444,
      "rmse_dtheta": 0.05212634801864624,
      "rmse_dx": 0.021023927256464958,
      "rmse_dy": 0.011302229948341846,
      "rmse_mean": 0.028150837868452072,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 10889.0,
      "step": 9407,
      "turn_loss": 0.2068047672510147,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.4370934770488757,
      "grad_norm": 0.4881146252155304,
      "learning_rate": 1.1301290633113226e-06,
      "loss": 0.098,
      "mae_dtheta": 0.04225832223892212,
      "mae_dx": 0.016786925494670868,
      "mae_dy": 0.00544586731120944,
      "pose_mae_dtheta": 0.35688287019729614,
      "pose_mae_dx": 0.10611607134342194,
      "pose_mae_dy": 0.06778093427419662,
      "pose_rmse_dtheta": 0.6265995502471924,
      "pose_rmse_dx": 0.23227307200431824,
      "pose_rmse_dy": 0.1739751547574997,
      "pose_rmse_mean": 0.3442825973033905,
      "rmse_dtheta": 0.06106685847043991,
      "rmse_dx": 0.03024579957127571,
      "rmse_dy": 0.00998513214290142,
      "rmse_mean": 0.03376593440771103,
      "rotation_flip": 0.010909090749919415,
      "sparse_tokens": 8556.0,
      "step": 9408,
      "turn_loss": 0.3098497986793518,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.43713993681471847,
      "grad_norm": 0.5651918053627014,
      "learning_rate": 1.1292919468045876e-06,
      "loss": 0.0854,
      "mae_dtheta": 0.00588342547416687,
      "mae_dx": 0.0010841195471584797,
      "mae_dy": 0.0009029395296238363,
      "pose_mae_dtheta": 0.03565294295549393,
      "pose_mae_dx": 0.011584760621190071,
      "pose_mae_dy": 0.011101205833256245,
      "pose_rmse_dtheta": 0.10889144986867905,
      "pose_rmse_dx": 0.02746874839067459,
      "pose_rmse_dy": 0.02952943742275238,
      "pose_rmse_mean": 0.05529654771089554,
      "rmse_dtheta": 0.018328988924622536,
      "rmse_dx": 0.0030689591076225042,
      "rmse_dy": 0.0021405252628028393,
      "rmse_mean": 0.007846157997846603,
      "rotation_flip": 0.0034217280335724354,
      "sparse_tokens": 32185.0,
      "step": 9409,
      "turn_loss": 0.04012715816497803,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.43718639658056124,
      "grad_norm": 0.610273540019989,
      "learning_rate": 1.128455100978546e-06,
      "loss": 0.1393,
      "mae_dtheta": 0.006447114050388336,
      "mae_dx": 0.001143813831731677,
      "mae_dy": 0.0006738974479958415,
      "pose_mae_dtheta": 0.04196838662028313,
      "pose_mae_dx": 0.009875291027128696,
      "pose_mae_dy": 0.009897129610180855,
      "pose_rmse_dtheta": 0.16948089003562927,
      "pose_rmse_dx": 0.023111160844564438,
      "pose_rmse_dy": 0.02635204792022705,
      "pose_rmse_mean": 0.07298137247562408,
      "rmse_dtheta": 0.021566063165664673,
      "rmse_dx": 0.0031512724235653877,
      "rmse_dy": 0.00157297367695719,
      "rmse_mean": 0.00876343622803688,
      "rotation_flip": 0.000978473573923111,
      "sparse_tokens": 32169.0,
      "step": 9410,
      "turn_loss": 0.03791792690753937,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.437232856346404,
      "grad_norm": 0.4761752188205719,
      "learning_rate": 1.1276185258917154e-06,
      "loss": 0.0847,
      "mae_dtheta": 0.008716972544789314,
      "mae_dx": 0.0013890122063457966,
      "mae_dy": 0.0017281894106417894,
      "pose_mae_dtheta": 0.05654142051935196,
      "pose_mae_dx": 0.014455609023571014,
      "pose_mae_dy": 0.02010512165725231,
      "pose_rmse_dtheta": 0.14331616461277008,
      "pose_rmse_dx": 0.038370195776224136,
      "pose_rmse_dy": 0.042554453015327454,
      "pose_rmse_mean": 0.07474693655967712,
      "rmse_dtheta": 0.020215949043631554,
      "rmse_dx": 0.004536270629614592,
      "rmse_dy": 0.0043572550639510155,
      "rmse_mean": 0.009703158400952816,
      "rotation_flip": 0.006762468256056309,
      "sparse_tokens": 32105.0,
      "step": 9411,
      "turn_loss": 0.06630067527294159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.4372793161122468,
      "grad_norm": 0.6272022128105164,
      "learning_rate": 1.1267822216026014e-06,
      "loss": 0.1863,
      "mae_dtheta": 0.0385492667555809,
      "mae_dx": 0.010612706653773785,
      "mae_dy": 0.007606391794979572,
      "pose_mae_dtheta": 0.28727540373802185,
      "pose_mae_dx": 0.09294505417346954,
      "pose_mae_dy": 0.060221634805202484,
      "pose_rmse_dtheta": 0.5056825876235962,
      "pose_rmse_dx": 0.19498343765735626,
      "pose_rmse_dy": 0.13913856446743011,
      "pose_rmse_mean": 0.2799348831176758,
      "rmse_dtheta": 0.05907508358359337,
      "rmse_dx": 0.021710192784667015,
      "rmse_dy": 0.017571786418557167,
      "rmse_mean": 0.03278568759560585,
      "rotation_flip": 0.010615711100399494,
      "sparse_tokens": 7507.0,
      "step": 9412,
      "turn_loss": 0.4965583086013794,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.4373257758780896,
      "grad_norm": 0.4426395893096924,
      "learning_rate": 1.1259461881696843e-06,
      "loss": 0.0805,
      "mae_dtheta": 0.018092939630150795,
      "mae_dx": 0.006397890858352184,
      "mae_dy": 0.003346350509673357,
      "pose_mae_dtheta": 0.14100921154022217,
      "pose_mae_dx": 0.05249399319291115,
      "pose_mae_dy": 0.052074287086725235,
      "pose_rmse_dtheta": 0.31357285380363464,
      "pose_rmse_dx": 0.13016819953918457,
      "pose_rmse_dy": 0.14244571328163147,
      "pose_rmse_mean": 0.1953955888748169,
      "rmse_dtheta": 0.03522510454058647,
      "rmse_dx": 0.016764484345912933,
      "rmse_dy": 0.0069637540727853775,
      "rmse_mean": 0.01965111494064331,
      "rotation_flip": 0.016241298988461494,
      "sparse_tokens": 10236.0,
      "step": 9413,
      "turn_loss": 0.13294853270053864,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.43737223564393235,
      "grad_norm": 0.5105611085891724,
      "learning_rate": 1.1251104256514294e-06,
      "loss": 0.1006,
      "mae_dtheta": 0.044844575226306915,
      "mae_dx": 0.01360897347331047,
      "mae_dy": 0.005845912266522646,
      "pose_mae_dtheta": 0.35534313321113586,
      "pose_mae_dx": 0.12285653501749039,
      "pose_mae_dy": 0.06187259778380394,
      "pose_rmse_dtheta": 0.5627306699752808,
      "pose_rmse_dx": 0.27325597405433655,
      "pose_rmse_dy": 0.1576382964849472,
      "pose_rmse_mean": 0.33120831847190857,
      "rmse_dtheta": 0.06397281587123871,
      "rmse_dx": 0.02650328539311886,
      "rmse_dy": 0.01449502445757389,
      "rmse_mean": 0.034990377724170685,
      "rotation_flip": 0.024390242993831635,
      "sparse_tokens": 5707.0,
      "step": 9414,
      "turn_loss": 0.2871493399143219,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.4374186954097751,
      "grad_norm": 0.4213559925556183,
      "learning_rate": 1.1242749341062837e-06,
      "loss": 0.0786,
      "mae_dtheta": 0.031504519283771515,
      "mae_dx": 0.008544002659618855,
      "mae_dy": 0.004054104909300804,
      "pose_mae_dtheta": 0.23218604922294617,
      "pose_mae_dx": 0.06347731500864029,
      "pose_mae_dy": 0.048509009182453156,
      "pose_rmse_dtheta": 0.4379971921443939,
      "pose_rmse_dx": 0.16058290004730225,
      "pose_rmse_dy": 0.11964918673038483,
      "pose_rmse_mean": 0.23940977454185486,
      "rmse_dtheta": 0.051253028213977814,
      "rmse_dx": 0.020208759233355522,
      "rmse_dy": 0.007951194420456886,
      "rmse_mean": 0.02647099457681179,
      "rotation_flip": 0.009212730452418327,
      "sparse_tokens": 20887.0,
      "step": 9415,
      "turn_loss": 0.1944621205329895,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.4374651551756179,
      "grad_norm": 0.6277942061424255,
      "learning_rate": 1.1234397135926705e-06,
      "loss": 0.1788,
      "mae_dtheta": 0.036567460745573044,
      "mae_dx": 0.01610308140516281,
      "mae_dy": 0.006675094831734896,
      "pose_mae_dtheta": 0.30959248542785645,
      "pose_mae_dx": 0.12986834347248077,
      "pose_mae_dy": 0.07603172957897186,
      "pose_rmse_dtheta": 0.5576306581497192,
      "pose_rmse_dx": 0.27553609013557434,
      "pose_rmse_dy": 0.1779852658510208,
      "pose_rmse_mean": 0.3370506763458252,
      "rmse_dtheta": 0.05636264383792877,
      "rmse_dx": 0.02992103435099125,
      "rmse_dy": 0.014994041062891483,
      "rmse_mean": 0.03375924006104469,
      "rotation_flip": 0.013812154531478882,
      "sparse_tokens": 18323.0,
      "step": 9416,
      "turn_loss": 0.3702109754085541,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4375116149414607,
      "grad_norm": 0.4473244249820709,
      "learning_rate": 1.1226047641690002e-06,
      "loss": 0.1202,
      "mae_dtheta": 0.007277118973433971,
      "mae_dx": 0.0011715355794876814,
      "mae_dy": 0.0005496570956893265,
      "pose_mae_dtheta": 0.054697904735803604,
      "pose_mae_dx": 0.00964006781578064,
      "pose_mae_dy": 0.009321055375039577,
      "pose_rmse_dtheta": 0.22417351603507996,
      "pose_rmse_dx": 0.026277121156454086,
      "pose_rmse_dy": 0.02846524678170681,
      "pose_rmse_mean": 0.09297196567058563,
      "rmse_dtheta": 0.025568367913365364,
      "rmse_dx": 0.003715676488354802,
      "rmse_dy": 0.001338993082754314,
      "rmse_mean": 0.010207679122686386,
      "rotation_flip": 0.0025526483077555895,
      "sparse_tokens": 32153.0,
      "step": 9417,
      "turn_loss": 0.040467310696840286,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.43755807470730346,
      "grad_norm": 0.37647613883018494,
      "learning_rate": 1.1217700858936587e-06,
      "loss": 0.0935,
      "mae_dtheta": 0.014754850417375565,
      "mae_dx": 0.0023451403249055147,
      "mae_dy": 0.0035877746995538473,
      "pose_mae_dtheta": 0.09712561219930649,
      "pose_mae_dx": 0.029097435995936394,
      "pose_mae_dy": 0.0377410426735878,
      "pose_rmse_dtheta": 0.21796691417694092,
      "pose_rmse_dx": 0.062278371304273605,
      "pose_rmse_dy": 0.08723580837249756,
      "pose_rmse_mean": 0.1224936991930008,
      "rmse_dtheta": 0.029346948489546776,
      "rmse_dx": 0.006378007121384144,
      "rmse_dy": 0.007367582526057959,
      "rmse_mean": 0.014364179223775864,
      "rotation_flip": 0.008620689623057842,
      "sparse_tokens": 32121.0,
      "step": 9418,
      "turn_loss": 0.12125823646783829,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.43760453447314623,
      "grad_norm": 0.5876486897468567,
      "learning_rate": 1.1209356788250181e-06,
      "loss": 0.1485,
      "mae_dtheta": 0.03392617031931877,
      "mae_dx": 0.010588651522994041,
      "mae_dy": 0.004563774913549423,
      "pose_mae_dtheta": 0.25986623764038086,
      "pose_mae_dx": 0.08941558748483658,
      "pose_mae_dy": 0.057377107441425323,
      "pose_rmse_dtheta": 0.45448824763298035,
      "pose_rmse_dx": 0.20720936357975006,
      "pose_rmse_dy": 0.13900692760944366,
      "pose_rmse_mean": 0.26690152287483215,
      "rmse_dtheta": 0.05084330961108208,
      "rmse_dx": 0.022927623242139816,
      "rmse_dy": 0.010138196870684624,
      "rmse_mean": 0.027969710528850555,
      "rotation_flip": 0.006163328420370817,
      "sparse_tokens": 21282.0,
      "step": 9419,
      "turn_loss": 0.2510136663913727,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 27254.0,
      "epoch": 0.437650994238989,
      "grad_norm": 0.6040272116661072,
      "learning_rate": 1.1201015430214258e-06,
      "loss": 0.1398,
      "mae_dtheta": 0.03218197077512741,
      "mae_dx": 0.007316215429455042,
      "mae_dy": 0.0062074800953269005,
      "pose_mae_dtheta": 0.2428220808506012,
      "pose_mae_dx": 0.0727478489279747,
      "pose_mae_dy": 0.06384231150150299,
      "pose_rmse_dtheta": 0.43361523747444153,
      "pose_rmse_dx": 0.15307405591011047,
      "pose_rmse_dy": 0.15920975804328918,
      "pose_rmse_mean": 0.2486330270767212,
      "rmse_dtheta": 0.0485452339053154,
      "rmse_dx": 0.01615862175822258,
      "rmse_dy": 0.011763432063162327,
      "rmse_mean": 0.025489095598459244,
      "rotation_flip": 0.01341281644999981,
      "sparse_tokens": 22100.0,
      "step": 9420,
      "turn_loss": 0.24978438019752502,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.43769745400483184,
      "grad_norm": 0.35188937187194824,
      "learning_rate": 1.1192676785412154e-06,
      "loss": 0.0998,
      "mae_dtheta": 0.039294127374887466,
      "mae_dx": 0.00801079161465168,
      "mae_dy": 0.004107114393264055,
      "pose_mae_dtheta": 0.29092302918434143,
      "pose_mae_dx": 0.05616826191544533,
      "pose_mae_dy": 0.03695232421159744,
      "pose_rmse_dtheta": 0.49465054273605347,
      "pose_rmse_dx": 0.13625957071781158,
      "pose_rmse_dy": 0.09540971368551254,
      "pose_rmse_mean": 0.2421066015958786,
      "rmse_dtheta": 0.05759119242429733,
      "rmse_dx": 0.01780863106250763,
      "rmse_dy": 0.01030222699046135,
      "rmse_mean": 0.028567349538207054,
      "rotation_flip": 0.015449438244104385,
      "sparse_tokens": 12371.0,
      "step": 9421,
      "turn_loss": 0.2682131826877594,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4377439137706746,
      "grad_norm": 0.5117394328117371,
      "learning_rate": 1.1184340854427005e-06,
      "loss": 0.0996,
      "mae_dtheta": 0.007785711903125048,
      "mae_dx": 0.0008181383018381894,
      "mae_dy": 0.0009431933867745101,
      "pose_mae_dtheta": 0.054293397814035416,
      "pose_mae_dx": 0.009633401408791542,
      "pose_mae_dy": 0.014569235034286976,
      "pose_rmse_dtheta": 0.19525256752967834,
      "pose_rmse_dx": 0.022291727364063263,
      "pose_rmse_dy": 0.03667526692152023,
      "pose_rmse_mean": 0.08473985642194748,
      "rmse_dtheta": 0.022619757801294327,
      "rmse_dx": 0.0026925960555672646,
      "rmse_dy": 0.0019763417076319456,
      "rmse_mean": 0.009096231311559677,
      "rotation_flip": 0.0012422360014170408,
      "sparse_tokens": 32121.0,
      "step": 9422,
      "turn_loss": 0.042114898562431335,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4377903735365174,
      "grad_norm": 0.5480066537857056,
      "learning_rate": 1.117600763784172e-06,
      "loss": 0.1119,
      "mae_dtheta": 0.007959895767271519,
      "mae_dx": 0.0017538198735564947,
      "mae_dy": 0.0020443128887563944,
      "pose_mae_dtheta": 0.058152277022600174,
      "pose_mae_dx": 0.021847203373908997,
      "pose_mae_dy": 0.02176409400999546,
      "pose_rmse_dtheta": 0.18577344715595245,
      "pose_rmse_dx": 0.10248525440692902,
      "pose_rmse_dy": 0.06383489817380905,
      "pose_rmse_mean": 0.1173645406961441,
      "rmse_dtheta": 0.02163512632250786,
      "rmse_dx": 0.007998183369636536,
      "rmse_dy": 0.006512337829917669,
      "rmse_mean": 0.012048549018800259,
      "rotation_flip": 0.007017544005066156,
      "sparse_tokens": 32073.0,
      "step": 9423,
      "turn_loss": 0.08128479868173599,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4378368333023602,
      "grad_norm": 0.38782578706741333,
      "learning_rate": 1.1167677136239068e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.00718989223241806,
      "mae_dx": 0.0023945914581418037,
      "mae_dy": 0.0007229147595353425,
      "pose_mae_dtheta": 0.05551686882972717,
      "pose_mae_dx": 0.019470971077680588,
      "pose_mae_dy": 0.01107062865048647,
      "pose_rmse_dtheta": 0.23353353142738342,
      "pose_rmse_dx": 0.0851830244064331,
      "pose_rmse_dy": 0.03321719542145729,
      "pose_rmse_mean": 0.1173112541437149,
      "rmse_dtheta": 0.025482630357146263,
      "rmse_dx": 0.008930518291890621,
      "rmse_dy": 0.0020400742068886757,
      "rmse_mean": 0.012151073664426804,
      "rotation_flip": 0.0027777778450399637,
      "sparse_tokens": 32185.0,
      "step": 9424,
      "turn_loss": 0.06867371499538422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.43788329306820295,
      "grad_norm": 0.6207098960876465,
      "learning_rate": 1.1159349350201587e-06,
      "loss": 0.1099,
      "mae_dtheta": 0.010457099415361881,
      "mae_dx": 0.0014638211578130722,
      "mae_dy": 0.0024607626255601645,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6207098364830017,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.1026153564453,
      "model/head/act_norm_mean": 102.03643860479798,
      "model/head/act_norm_min": 54.31027603149414,
      "model/head/act_over_embed": 70.12039588940607,
      "model/head/grad_frac": 0.09398429840803146,
      "model/head/grad_norm": 0.058336980640888214,
      "model/head/grad_zero_frac": 0.00019290123600512743,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7078203914141414,
      "model/head/update_ratio": 0.0009932738030329347,
      "model/head/weight_delta": 9.906373977661133,
      "model/head/weight_delta_rel": 0.17378714680671692,
      "model/head/weight_norm": 58.732025146484375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4227885603904724,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227062524189048,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226294755935669,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29048769410055697,
      "model/modality_embedder.encoders.pose/grad_frac": 0.13599148392677307,
      "model/modality_embedder.encoders.pose/grad_norm": 0.08441124856472015,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.545929939516129,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0027256503235548735,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1410508155822754,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10262791812419891,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969215393066406,
      "model/modality_embedder/grad_frac": 0.13599148392677307,
      "model/modality_embedder/grad_norm": 0.08441124856472015,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.545929939516129,
      "model/modality_embedder/update_ratio": 0.0027256503235548735,
      "model/modality_embedder/weight_delta": 3.1410508155822754,
      "model/modality_embedder/weight_delta_rel": 0.10262791812419891,
      "model/modality_embedder/weight_norm": 30.969215393066406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.26561737060547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.846152497194165,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.063572883605957,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.700089885121386,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06430763006210327,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.039916377514600754,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014280311297625303,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.70055890083313,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0984099954366684,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.952035903930664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.93562316894531,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.801336780503448,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.34276008605957,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.356501467187677,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06774675101041794,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04205107316374779,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014131953939795494,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4239416122436523,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1186080127954483,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.75602149963379,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.79743957519531,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.653627044252044,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.62594223022461,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.629412677850382,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07035969942808151,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04367295652627945,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014213580871000886,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7067315578460693,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12446510791778564,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.72621726989746,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.62140655517578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.391241281866282,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.417677879333496,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.823517449739683,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06735887378454208,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04181031510233879,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001396335894241929,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1830897331237793,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10878290235996246,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9428768157959,
      "model/normalizer/grad_frac": 0.2316223531961441,
      "model/normalizer/grad_norm": 0.1437702775001526,
      "model/normalizer/grad_zero_frac": 0.00018198772158939391,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018281794618815184,
      "model/normalizer/weight_delta": 6.701265335083008,
      "model/normalizer/weight_delta_rel": 0.08630841970443726,
      "model/normalizer/weight_norm": 78.64122772216797,
      "pose_mae_dtheta": 0.06363169848918915,
      "pose_mae_dx": 0.0204441100358963,
      "pose_mae_dy": 0.026253273710608482,
      "pose_rmse_dtheta": 0.15524128079414368,
      "pose_rmse_dx": 0.053666166961193085,
      "pose_rmse_dy": 0.06469175964593887,
      "pose_rmse_mean": 0.09119974076747894,
      "rmse_dtheta": 0.02208336442708969,
      "rmse_dx": 0.005023910664021969,
      "rmse_dy": 0.005418374203145504,
      "rmse_mean": 0.010841883718967438,
      "rotation_flip": 0.002585888374596834,
      "sparse_tokens": 32057.0,
      "step": 9425,
      "turn_loss": 0.08903270214796066,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4379297528340457,
      "grad_norm": 0.6457341909408569,
      "learning_rate": 1.1151024280311668e-06,
      "loss": 0.1453,
      "mae_dtheta": 0.01200140081346035,
      "mae_dx": 0.0014753141440451145,
      "mae_dy": 0.0025701068807393312,
      "pose_mae_dtheta": 0.07586853951215744,
      "pose_mae_dx": 0.021009603515267372,
      "pose_mae_dy": 0.02959631383419037,
      "pose_rmse_dtheta": 0.19867733120918274,
      "pose_rmse_dx": 0.055524975061416626,
      "pose_rmse_dy": 0.06374162435531616,
      "pose_rmse_mean": 0.10598131269216537,
      "rmse_dtheta": 0.025819823145866394,
      "rmse_dx": 0.005030723288655281,
      "rmse_dy": 0.005534579046070576,
      "rmse_mean": 0.012128375470638275,
      "rotation_flip": 0.006566946394741535,
      "sparse_tokens": 32057.0,
      "step": 9426,
      "turn_loss": 0.09552212059497833,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.4379762125998885,
      "grad_norm": 0.6016165018081665,
      "learning_rate": 1.1142701927151456e-06,
      "loss": 0.1405,
      "mae_dtheta": 0.025270018726587296,
      "mae_dx": 0.012071812525391579,
      "mae_dy": 0.0057300119660794735,
      "pose_mae_dtheta": 0.18471761047840118,
      "pose_mae_dx": 0.09598026424646378,
      "pose_mae_dy": 0.06692887097597122,
      "pose_rmse_dtheta": 0.34130194783210754,
      "pose_rmse_dx": 0.23563836514949799,
      "pose_rmse_dy": 0.14752021431922913,
      "pose_rmse_mean": 0.2414868324995041,
      "rmse_dtheta": 0.04049475118517876,
      "rmse_dx": 0.026291660964488983,
      "rmse_dy": 0.011453907005488873,
      "rmse_mean": 0.02608010545372963,
      "rotation_flip": 0.00935672502964735,
      "sparse_tokens": 16629.0,
      "step": 9427,
      "turn_loss": 0.2287023663520813,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4380226723657313,
      "grad_norm": 0.40440499782562256,
      "learning_rate": 1.113438229130297e-06,
      "loss": 0.0896,
      "mae_dtheta": 0.012480109930038452,
      "mae_dx": 0.0028211763128638268,
      "mae_dy": 0.003812462091445923,
      "pose_mae_dtheta": 0.0831952840089798,
      "pose_mae_dx": 0.03095742128789425,
      "pose_mae_dy": 0.03206890448927879,
      "pose_rmse_dtheta": 0.20238684117794037,
      "pose_rmse_dx": 0.08897440880537033,
      "pose_rmse_dy": 0.06928810477256775,
      "pose_rmse_mean": 0.12021645158529282,
      "rmse_dtheta": 0.025730933994054794,
      "rmse_dx": 0.008188068866729736,
      "rmse_dy": 0.009222228080034256,
      "rmse_mean": 0.014380410313606262,
      "rotation_flip": 0.005689001176506281,
      "sparse_tokens": 32121.0,
      "step": 9428,
      "turn_loss": 0.1240539625287056,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.43806913213157406,
      "grad_norm": 0.6927976012229919,
      "learning_rate": 1.1126065373347972e-06,
      "loss": 0.1845,
      "mae_dtheta": 0.026305029168725014,
      "mae_dx": 0.011137591674923897,
      "mae_dy": 0.0031657200306653976,
      "pose_mae_dtheta": 0.22315095365047455,
      "pose_mae_dx": 0.09048280864953995,
      "pose_mae_dy": 0.042605914175510406,
      "pose_rmse_dtheta": 0.4582349359989166,
      "pose_rmse_dx": 0.23179049789905548,
      "pose_rmse_dy": 0.11398090422153473,
      "pose_rmse_mean": 0.26800212264060974,
      "rmse_dtheta": 0.045780833810567856,
      "rmse_dx": 0.024452511221170425,
      "rmse_dy": 0.007159143220633268,
      "rmse_mean": 0.025797497481107712,
      "rotation_flip": 0.010526316240429878,
      "sparse_tokens": 16734.0,
      "step": 9429,
      "turn_loss": 0.17222638428211212,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.43811559189741683,
      "grad_norm": 0.8556451201438904,
      "learning_rate": 1.1117751173868107e-06,
      "loss": 0.2459,
      "mae_dtheta": 0.031180238351225853,
      "mae_dx": 0.012421669438481331,
      "mae_dy": 0.0036234213039278984,
      "pose_mae_dtheta": 0.2480759173631668,
      "pose_mae_dx": 0.09352011233568192,
      "pose_mae_dy": 0.040065668523311615,
      "pose_rmse_dtheta": 0.46942225098609924,
      "pose_rmse_dx": 0.2211058884859085,
      "pose_rmse_dy": 0.10885800421237946,
      "pose_rmse_mean": 0.2664620578289032,
      "rmse_dtheta": 0.049530014395713806,
      "rmse_dx": 0.025389529764652252,
      "rmse_dy": 0.006847166456282139,
      "rmse_mean": 0.027255570515990257,
      "rotation_flip": 0.0138248847797513,
      "sparse_tokens": 21256.0,
      "step": 9430,
      "turn_loss": 0.2258853167295456,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4381620516632596,
      "grad_norm": 0.5056444406509399,
      "learning_rate": 1.1109439693444758e-06,
      "loss": 0.1614,
      "mae_dtheta": 0.008124166168272495,
      "mae_dx": 0.0014421682571992278,
      "mae_dy": 0.0019920070189982653,
      "pose_mae_dtheta": 0.05732203274965286,
      "pose_mae_dx": 0.018034959211945534,
      "pose_mae_dy": 0.020281756296753883,
      "pose_rmse_dtheta": 0.18858587741851807,
      "pose_rmse_dx": 0.04797754064202309,
      "pose_rmse_dy": 0.04933876171708107,
      "pose_rmse_mean": 0.09530072659254074,
      "rmse_dtheta": 0.02150704152882099,
      "rmse_dx": 0.004381273407489061,
      "rmse_dy": 0.004583895672112703,
      "rmse_mean": 0.010157403536140919,
      "rotation_flip": 0.0018042399315163493,
      "sparse_tokens": 32089.0,
      "step": 9431,
      "turn_loss": 0.06108633056282997,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4382085114291024,
      "grad_norm": 0.6467071771621704,
      "learning_rate": 1.1101130932659177e-06,
      "loss": 0.1501,
      "mae_dtheta": 0.005448366515338421,
      "mae_dx": 0.001129241893067956,
      "mae_dy": 0.0002946699387393892,
      "pose_mae_dtheta": 0.03725413605570793,
      "pose_mae_dx": 0.008825286291539669,
      "pose_mae_dy": 0.004292533732950687,
      "pose_rmse_dtheta": 0.185552716255188,
      "pose_rmse_dx": 0.02055717445909977,
      "pose_rmse_dy": 0.014245275408029556,
      "pose_rmse_mean": 0.07345172762870789,
      "rmse_dtheta": 0.02315918728709221,
      "rmse_dx": 0.003100247588008642,
      "rmse_dy": 0.0008072418277151883,
      "rmse_mean": 0.009022226557135582,
      "rotation_flip": 0.0013468012912198901,
      "sparse_tokens": 32185.0,
      "step": 9432,
      "turn_loss": 0.035220250487327576,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.43825497119494516,
      "grad_norm": 0.6306110620498657,
      "learning_rate": 1.1092824892092375e-06,
      "loss": 0.1301,
      "mae_dtheta": 0.015019441023468971,
      "mae_dx": 0.00178054952993989,
      "mae_dy": 0.002640601247549057,
      "pose_mae_dtheta": 0.10652969777584076,
      "pose_mae_dx": 0.025335058569908142,
      "pose_mae_dy": 0.0361100398004055,
      "pose_rmse_dtheta": 0.2811005711555481,
      "pose_rmse_dx": 0.06540626287460327,
      "pose_rmse_dy": 0.08637461811304092,
      "pose_rmse_mean": 0.14429381489753723,
      "rmse_dtheta": 0.03264410048723221,
      "rmse_dx": 0.005207967013120651,
      "rmse_dy": 0.005595135036855936,
      "rmse_mean": 0.014482401311397552,
      "rotation_flip": 0.0064239827916026115,
      "sparse_tokens": 32121.0,
      "step": 9433,
      "turn_loss": 0.11132810264825821,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.43830143096078794,
      "grad_norm": 0.3438771963119507,
      "learning_rate": 1.1084521572325224e-06,
      "loss": 0.0856,
      "mae_dtheta": 0.03517775237560272,
      "mae_dx": 0.011047909036278725,
      "mae_dy": 0.004972490482032299,
      "pose_mae_dtheta": 0.2901283800601959,
      "pose_mae_dx": 0.08622797578573227,
      "pose_mae_dy": 0.053657155483961105,
      "pose_rmse_dtheta": 0.5197338461875916,
      "pose_rmse_dx": 0.19395369291305542,
      "pose_rmse_dy": 0.1315925121307373,
      "pose_rmse_mean": 0.281760036945343,
      "rmse_dtheta": 0.05276256054639816,
      "rmse_dx": 0.02243947796523571,
      "rmse_dy": 0.0106702521443367,
      "rmse_mean": 0.028624098747968674,
      "rotation_flip": 0.009508715942502022,
      "sparse_tokens": 10702.0,
      "step": 9434,
      "turn_loss": 0.28122299909591675,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.4383478907266307,
      "grad_norm": 0.6866402626037598,
      "learning_rate": 1.1076220973938352e-06,
      "loss": 0.1323,
      "mae_dtheta": 0.037302903831005096,
      "mae_dx": 0.00835330318659544,
      "mae_dy": 0.004340687766671181,
      "pose_mae_dtheta": 0.27877938747406006,
      "pose_mae_dx": 0.0741535946726799,
      "pose_mae_dy": 0.04148908704519272,
      "pose_rmse_dtheta": 0.5273151397705078,
      "pose_rmse_dx": 0.17591649293899536,
      "pose_rmse_dy": 0.09216883033514023,
      "pose_rmse_mean": 0.26513350009918213,
      "rmse_dtheta": 0.05881296470761299,
      "rmse_dx": 0.019314005970954895,
      "rmse_dy": 0.008398100733757019,
      "rmse_mean": 0.028841689229011536,
      "rotation_flip": 0.02003338932991028,
      "sparse_tokens": 10598.0,
      "step": 9435,
      "turn_loss": 0.21816189587116241,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.4383943504924735,
      "grad_norm": 0.5297450423240662,
      "learning_rate": 1.1067923097512256e-06,
      "loss": 0.1406,
      "mae_dtheta": 0.03960249572992325,
      "mae_dx": 0.009776501916348934,
      "mae_dy": 0.011372409760951996,
      "pose_mae_dtheta": 0.2702711820602417,
      "pose_mae_dx": 0.08879990130662918,
      "pose_mae_dy": 0.11835088580846786,
      "pose_rmse_dtheta": 0.4975363314151764,
      "pose_rmse_dx": 0.20519046485424042,
      "pose_rmse_dy": 0.3268332779407501,
      "pose_rmse_mean": 0.34318670630455017,
      "rmse_dtheta": 0.0627564787864685,
      "rmse_dx": 0.020903952419757843,
      "rmse_dy": 0.025266842916607857,
      "rmse_mean": 0.03630909323692322,
      "rotation_flip": 0.014858840964734554,
      "sparse_tokens": 10943.0,
      "step": 9436,
      "turn_loss": 0.4451451301574707,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.43844081025831627,
      "grad_norm": 0.4096168279647827,
      "learning_rate": 1.1059627943627177e-06,
      "loss": 0.0838,
      "mae_dtheta": 0.009666703641414642,
      "mae_dx": 0.0012368345633149147,
      "mae_dy": 0.0022723511792719364,
      "pose_mae_dtheta": 0.06334943324327469,
      "pose_mae_dx": 0.019778214395046234,
      "pose_mae_dy": 0.03107675164937973,
      "pose_rmse_dtheta": 0.11608763784170151,
      "pose_rmse_dx": 0.050405748188495636,
      "pose_rmse_dy": 0.06971283257007599,
      "pose_rmse_mean": 0.07873541116714478,
      "rmse_dtheta": 0.017947271466255188,
      "rmse_dx": 0.0037689614109694958,
      "rmse_dy": 0.004435275215655565,
      "rmse_mean": 0.008717169985175133,
      "rotation_flip": 0.0069116041995584965,
      "sparse_tokens": 32089.0,
      "step": 9437,
      "turn_loss": 0.08601056784391403,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35688.0,
      "epoch": 0.4384872700241591,
      "grad_norm": 0.5506502389907837,
      "learning_rate": 1.1051335512863232e-06,
      "loss": 0.164,
      "mae_dtheta": 0.029120605438947678,
      "mae_dx": 0.008301644586026669,
      "mae_dy": 0.004746072925627232,
      "pose_mae_dtheta": 0.20813694596290588,
      "pose_mae_dx": 0.07142937928438187,
      "pose_mae_dy": 0.05851002782583237,
      "pose_rmse_dtheta": 0.39935967326164246,
      "pose_rmse_dx": 0.1891123503446579,
      "pose_rmse_dy": 0.1313091665506363,
      "pose_rmse_mean": 0.23992705345153809,
      "rmse_dtheta": 0.047695841640233994,
      "rmse_dx": 0.020219333469867706,
      "rmse_dy": 0.009678896516561508,
      "rmse_mean": 0.02586469054222107,
      "rotation_flip": 0.011583011597394943,
      "sparse_tokens": 27871.0,
      "step": 9438,
      "turn_loss": 0.22096623480319977,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.4385337297900019,
      "grad_norm": 0.6374863982200623,
      "learning_rate": 1.1043045805800285e-06,
      "loss": 0.1355,
      "mae_dtheta": 0.030075952410697937,
      "mae_dx": 0.009963038377463818,
      "mae_dy": 0.00590527756139636,
      "pose_mae_dtheta": 0.2006145566701889,
      "pose_mae_dx": 0.0750691145658493,
      "pose_mae_dy": 0.072429358959198,
      "pose_rmse_dtheta": 0.3449230194091797,
      "pose_rmse_dx": 0.18450000882148743,
      "pose_rmse_dy": 0.14194633066654205,
      "pose_rmse_mean": 0.223789781332016,
      "rmse_dtheta": 0.04641704261302948,
      "rmse_dx": 0.022189488634467125,
      "rmse_dy": 0.012065139599144459,
      "rmse_mean": 0.026890559121966362,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 8296.0,
      "step": 9439,
      "turn_loss": 0.30704590678215027,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 14943.0,
      "epoch": 0.43858018955584466,
      "grad_norm": 0.5952208638191223,
      "learning_rate": 1.1034758823018055e-06,
      "loss": 0.1408,
      "mae_dtheta": 0.027358684688806534,
      "mae_dx": 0.00655145850032568,
      "mae_dy": 0.0030978790018707514,
      "pose_mae_dtheta": 0.1909562349319458,
      "pose_mae_dx": 0.04478790983557701,
      "pose_mae_dy": 0.02857825718820095,
      "pose_rmse_dtheta": 0.37570667266845703,
      "pose_rmse_dx": 0.11274123191833496,
      "pose_rmse_dy": 0.08100058138370514,
      "pose_rmse_mean": 0.1898161619901657,
      "rmse_dtheta": 0.04730333015322685,
      "rmse_dx": 0.016416771337389946,
      "rmse_dy": 0.008358028717339039,
      "rmse_mean": 0.024026043713092804,
      "rotation_flip": 0.012515644542872906,
      "sparse_tokens": 12110.0,
      "step": 9440,
      "turn_loss": 0.19180768728256226,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.43862664932168743,
      "grad_norm": 0.5448035001754761,
      "learning_rate": 1.1026474565096068e-06,
      "loss": 0.1051,
      "mae_dtheta": 0.008271032944321632,
      "mae_dx": 0.0025525155942887068,
      "mae_dy": 0.0021244001109153032,
      "pose_mae_dtheta": 0.05934489518404007,
      "pose_mae_dx": 0.026968471705913544,
      "pose_mae_dy": 0.02601412497460842,
      "pose_rmse_dtheta": 0.1525299847126007,
      "pose_rmse_dx": 0.09619278460741043,
      "pose_rmse_dy": 0.09418012201786041,
      "pose_rmse_mean": 0.11430096626281738,
      "rmse_dtheta": 0.020164528861641884,
      "rmse_dx": 0.009513604454696178,
      "rmse_dy": 0.006578914821147919,
      "rmse_mean": 0.012085682712495327,
      "rotation_flip": 0.0025575447361916304,
      "sparse_tokens": 32073.0,
      "step": 9441,
      "turn_loss": 0.09036021679639816,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4386731090875302,
      "grad_norm": 0.47556909918785095,
      "learning_rate": 1.1018193032613616e-06,
      "loss": 0.1165,
      "mae_dtheta": 0.0125098442658782,
      "mae_dx": 0.0020994769874960184,
      "mae_dy": 0.0045580328442156315,
      "pose_mae_dtheta": 0.08015424013137817,
      "pose_mae_dx": 0.03615768626332283,
      "pose_mae_dy": 0.04632815346121788,
      "pose_rmse_dtheta": 0.14745312929153442,
      "pose_rmse_dx": 0.10307180881500244,
      "pose_rmse_dy": 0.0998183861374855,
      "pose_rmse_mean": 0.11678110808134079,
      "rmse_dtheta": 0.021850407123565674,
      "rmse_dx": 0.0054153259843587875,
      "rmse_dy": 0.009055822156369686,
      "rmse_mean": 0.01210718508809805,
      "rotation_flip": 0.00864897109568119,
      "sparse_tokens": 32073.0,
      "step": 9442,
      "turn_loss": 0.12611785531044006,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.438719568853373,
      "grad_norm": 0.4197360575199127,
      "learning_rate": 1.1009914226149865e-06,
      "loss": 0.1063,
      "mae_dtheta": 0.02963954396545887,
      "mae_dx": 0.008208763785660267,
      "mae_dy": 0.004638938698917627,
      "pose_mae_dtheta": 0.21037116646766663,
      "pose_mae_dx": 0.061980511993169785,
      "pose_mae_dy": 0.06051631644368172,
      "pose_rmse_dtheta": 0.39242789149284363,
      "pose_rmse_dx": 0.15564388036727905,
      "pose_rmse_dy": 0.14958792924880981,
      "pose_rmse_mean": 0.23255322873592377,
      "rmse_dtheta": 0.047195471823215485,
      "rmse_dx": 0.01947559230029583,
      "rmse_dy": 0.008524547331035137,
      "rmse_mean": 0.02506520412862301,
      "rotation_flip": 0.011340206488966942,
      "sparse_tokens": 16745.0,
      "step": 9443,
      "turn_loss": 0.23875147104263306,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.43876602861921576,
      "grad_norm": 1.028601884841919,
      "learning_rate": 1.1001638146283728e-06,
      "loss": 0.2959,
      "mae_dtheta": 0.04822702705860138,
      "mae_dx": 0.015814241021871567,
      "mae_dy": 0.006917978171259165,
      "pose_mae_dtheta": 0.42711615562438965,
      "pose_mae_dx": 0.11337500065565109,
      "pose_mae_dy": 0.07702071964740753,
      "pose_rmse_dtheta": 0.706808865070343,
      "pose_rmse_dx": 0.21764256060123444,
      "pose_rmse_dy": 0.20118224620819092,
      "pose_rmse_mean": 0.375211238861084,
      "rmse_dtheta": 0.06903859227895737,
      "rmse_dx": 0.027957094833254814,
      "rmse_dy": 0.014138671569526196,
      "rmse_mean": 0.03704478591680527,
      "rotation_flip": 0.02247191034257412,
      "sparse_tokens": 13492.0,
      "step": 9444,
      "turn_loss": 0.33356326818466187,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.43881248838505854,
      "grad_norm": 0.3965635299682617,
      "learning_rate": 1.099336479359398e-06,
      "loss": 0.0811,
      "mae_dtheta": 0.00859364029020071,
      "mae_dx": 0.0011190585792064667,
      "mae_dy": 0.0017463590484112501,
      "pose_mae_dtheta": 0.05699198320508003,
      "pose_mae_dx": 0.01649973914027214,
      "pose_mae_dy": 0.022320454940199852,
      "pose_rmse_dtheta": 0.16249290108680725,
      "pose_rmse_dx": 0.04089150205254555,
      "pose_rmse_dy": 0.04816191643476486,
      "pose_rmse_mean": 0.08384877443313599,
      "rmse_dtheta": 0.018915612250566483,
      "rmse_dx": 0.0033316477201879025,
      "rmse_dy": 0.0035064206458628178,
      "rmse_mean": 0.008584560826420784,
      "rotation_flip": 0.004678362514823675,
      "sparse_tokens": 32089.0,
      "step": 9445,
      "turn_loss": 0.057971447706222534,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4388589481509013,
      "grad_norm": 0.4795474708080292,
      "learning_rate": 1.098509416865915e-06,
      "loss": 0.1042,
      "mae_dtheta": 0.012079778127372265,
      "mae_dx": 0.0021715008188039064,
      "mae_dy": 0.002466962207108736,
      "pose_mae_dtheta": 0.0819769948720932,
      "pose_mae_dx": 0.02900538593530655,
      "pose_mae_dy": 0.03449857234954834,
      "pose_rmse_dtheta": 0.20061904191970825,
      "pose_rmse_dx": 0.07914899289608002,
      "pose_rmse_dy": 0.08077321201562881,
      "pose_rmse_mean": 0.12018042057752609,
      "rmse_dtheta": 0.024762749671936035,
      "rmse_dx": 0.007530432194471359,
      "rmse_dy": 0.0051456172950565815,
      "rmse_mean": 0.012479599565267563,
      "rotation_flip": 0.00511727062985301,
      "sparse_tokens": 32041.0,
      "step": 9446,
      "turn_loss": 0.09845668077468872,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4563.0,
      "epoch": 0.4389054079167441,
      "grad_norm": 1.5209181308746338,
      "learning_rate": 1.0976826272057628e-06,
      "loss": 0.3162,
      "mae_dtheta": 0.0691390112042427,
      "mae_dx": 0.012856449000537395,
      "mae_dy": 0.010106419213116169,
      "pose_mae_dtheta": 0.5724331736564636,
      "pose_mae_dx": 0.10953880846500397,
      "pose_mae_dy": 0.061770446598529816,
      "pose_rmse_dtheta": 0.8746963739395142,
      "pose_rmse_dx": 0.21444271504878998,
      "pose_rmse_dy": 0.11964842677116394,
      "pose_rmse_mean": 0.4029291868209839,
      "rmse_dtheta": 0.08938530832529068,
      "rmse_dx": 0.02349129505455494,
      "rmse_dy": 0.02466544136404991,
      "rmse_mean": 0.04584734886884689,
      "rotation_flip": 0.018018018454313278,
      "sparse_tokens": 3920.0,
      "step": 9447,
      "turn_loss": 0.49526771903038025,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.43895186768258687,
      "grad_norm": 0.2910672724246979,
      "learning_rate": 1.0968561104367603e-06,
      "loss": 0.0633,
      "mae_dtheta": 0.007161365821957588,
      "mae_dx": 0.000976849114522338,
      "mae_dy": 0.0010841470211744308,
      "pose_mae_dtheta": 0.048574209213256836,
      "pose_mae_dx": 0.011106083169579506,
      "pose_mae_dy": 0.017543304711580276,
      "pose_rmse_dtheta": 0.14101077616214752,
      "pose_rmse_dx": 0.0324750691652298,
      "pose_rmse_dy": 0.049245595932006836,
      "pose_rmse_mean": 0.07424381375312805,
      "rmse_dtheta": 0.019336242228746414,
      "rmse_dx": 0.003003130666911602,
      "rmse_dy": 0.00254345266148448,
      "rmse_mean": 0.008294275961816311,
      "rotation_flip": 0.00297745643183589,
      "sparse_tokens": 32137.0,
      "step": 9448,
      "turn_loss": 0.04832734912633896,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.43899832744842965,
      "grad_norm": 1.0100836753845215,
      "learning_rate": 1.096029866616704e-06,
      "loss": 0.2843,
      "mae_dtheta": 0.016535945236682892,
      "mae_dx": 0.0035021277144551277,
      "mae_dy": 0.0033185812644660473,
      "pose_mae_dtheta": 0.13629885017871857,
      "pose_mae_dx": 0.037488751113414764,
      "pose_mae_dy": 0.0505015030503273,
      "pose_rmse_dtheta": 0.26256632804870605,
      "pose_rmse_dx": 0.161415696144104,
      "pose_rmse_dy": 0.1142062246799469,
      "pose_rmse_mean": 0.17939607799053192,
      "rmse_dtheta": 0.030081942677497864,
      "rmse_dx": 0.014104765839874744,
      "rmse_dy": 0.007535295560956001,
      "rmse_mean": 0.017240669578313828,
      "rotation_flip": 0.0076045626774430275,
      "sparse_tokens": 8139.0,
      "step": 9449,
      "turn_loss": 0.11270980536937714,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4390447872142724,
      "grad_norm": 0.48267003893852234,
      "learning_rate": 1.0952038958033756e-06,
      "loss": 0.0727,
      "mae_dtheta": 0.007806417532265186,
      "mae_dx": 0.0012843674048781395,
      "mae_dy": 0.0017476272769272327,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.48266997933387756,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 163.55328369140625,
      "model/head/act_norm_mean": 114.56995738636364,
      "model/head/act_norm_min": 63.04371643066406,
      "model/head/act_over_embed": 78.73354733674957,
      "model/head/grad_frac": 0.07978714257478714,
      "model/head/grad_norm": 0.03851085901260376,
      "model/head/grad_zero_frac": 0.00018147945229429752,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7103604403409091,
      "model/head/update_ratio": 0.0006556999869644642,
      "model/head/weight_delta": 9.908777236938477,
      "model/head/weight_delta_rel": 0.17382930219173431,
      "model/head/weight_norm": 58.73243713378906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42278194427490234,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227090879928234,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226337671279907,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904896427335009,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1865946501493454,
      "model/modality_embedder.encoders.pose/grad_norm": 0.09006363898515701,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5315406976744186,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0029081713873893023,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1405954360961914,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10261303931474686,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969165802001953,
      "model/modality_embedder/grad_frac": 0.1865946501493454,
      "model/modality_embedder/grad_norm": 0.09006363898515701,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5315406976744186,
      "model/modality_embedder/update_ratio": 0.0029081713873893023,
      "model/modality_embedder/weight_delta": 3.1405954360961914,
      "model/modality_embedder/weight_delta_rel": 0.10261303931474686,
      "model/modality_embedder/weight_norm": 30.969165802001953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.92212677001953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.023308481641816,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.89729118347168,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.509042498341774,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.04998353496193886,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02412555180490017,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008630993543192744,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7015695571899414,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09844682365655899,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95223045349121,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.89262390136719,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.995448031906367,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.203728675842285,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.177105898597436,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05467153340578079,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02638830803334713,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008868107106536627,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.425454616546631,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11866042762994766,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.75641632080078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.75489807128906,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.81733756212923,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.30054759979248,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.4291254405651,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05228598415851593,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02523687481880188,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008213363471440971,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7083959579467773,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12452099472284317,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.72660255432129,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.43888092041016,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.506701438993105,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.33729076385498,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.590072112819758,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.052035875618457794,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.025116154924035072,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.000838788109831512,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.184812068939209,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10884176194667816,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.943384170532227,
      "model/normalizer/grad_frac": 0.20248322188854218,
      "model/normalizer/grad_norm": 0.09773257374763489,
      "model/normalizer/grad_zero_frac": 0.00019144162070006132,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0012427580077201128,
      "model/normalizer/weight_delta": 6.704342842102051,
      "model/normalizer/weight_delta_rel": 0.08634805679321289,
      "model/normalizer/weight_norm": 78.64167785644531,
      "pose_mae_dtheta": 0.051031604409217834,
      "pose_mae_dx": 0.014141934923827648,
      "pose_mae_dy": 0.020560160279273987,
      "pose_rmse_dtheta": 0.14873512089252472,
      "pose_rmse_dx": 0.04662303626537323,
      "pose_rmse_dy": 0.052512574940919876,
      "pose_rmse_mean": 0.08262357860803604,
      "rmse_dtheta": 0.01969313435256481,
      "rmse_dx": 0.0053918627090752125,
      "rmse_dy": 0.004662676714360714,
      "rmse_mean": 0.009915891103446484,
      "rotation_flip": 0.005191127769649029,
      "sparse_tokens": 32041.0,
      "step": 9450,
      "turn_loss": 0.06605581194162369,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31692.0,
      "epoch": 0.4390912469801152,
      "grad_norm": 0.4792496860027313,
      "learning_rate": 1.0943781980545332e-06,
      "loss": 0.1197,
      "mae_dtheta": 0.03629925847053528,
      "mae_dx": 0.00998882669955492,
      "mae_dy": 0.0062647671438753605,
      "pose_mae_dtheta": 0.2956591248512268,
      "pose_mae_dx": 0.07398609071969986,
      "pose_mae_dy": 0.06193326413631439,
      "pose_rmse_dtheta": 0.5244500041007996,
      "pose_rmse_dx": 0.1610797792673111,
      "pose_rmse_dy": 0.13408711552619934,
      "pose_rmse_mean": 0.27320563793182373,
      "rmse_dtheta": 0.05612786486744881,
      "rmse_dx": 0.021501341834664345,
      "rmse_dy": 0.013638533651828766,
      "rmse_mean": 0.030422581359744072,
      "rotation_flip": 0.015793252736330032,
      "sparse_tokens": 26720.0,
      "step": 9451,
      "turn_loss": 0.2668578028678894,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.439137706745958,
      "grad_norm": 0.8866615295410156,
      "learning_rate": 1.0935527734279195e-06,
      "loss": 0.1265,
      "mae_dtheta": 0.032662536948919296,
      "mae_dx": 0.008253591135144234,
      "mae_dy": 0.002793562365695834,
      "pose_mae_dtheta": 0.2507297694683075,
      "pose_mae_dx": 0.059453632682561874,
      "pose_mae_dy": 0.038590241223573685,
      "pose_rmse_dtheta": 0.4853091537952423,
      "pose_rmse_dx": 0.15663748979568481,
      "pose_rmse_dy": 0.08579330146312714,
      "pose_rmse_mean": 0.24257999658584595,
      "rmse_dtheta": 0.0523538775742054,
      "rmse_dx": 0.018723441287875175,
      "rmse_dy": 0.005472577176988125,
      "rmse_mean": 0.025516632944345474,
      "rotation_flip": 0.013487475924193859,
      "sparse_tokens": 8702.0,
      "step": 9452,
      "turn_loss": 0.18936164677143097,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.43918416651180076,
      "grad_norm": 0.5723221302032471,
      "learning_rate": 1.0927276219812587e-06,
      "loss": 0.1001,
      "mae_dtheta": 0.005766095127910376,
      "mae_dx": 0.001467919908463955,
      "mae_dy": 0.000760261551477015,
      "pose_mae_dtheta": 0.043367333710193634,
      "pose_mae_dx": 0.013079389929771423,
      "pose_mae_dy": 0.012330065481364727,
      "pose_rmse_dtheta": 0.14898337423801422,
      "pose_rmse_dx": 0.03214341774582863,
      "pose_rmse_dy": 0.036991484463214874,
      "pose_rmse_mean": 0.07270609587430954,
      "rmse_dtheta": 0.017930850386619568,
      "rmse_dx": 0.0045120129361748695,
      "rmse_dy": 0.0020749676041305065,
      "rmse_mean": 0.008172610774636269,
      "rotation_flip": 0.0027347311843186617,
      "sparse_tokens": 32217.0,
      "step": 9453,
      "turn_loss": 0.046232614666223526,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7815.0,
      "epoch": 0.4392306262776436,
      "grad_norm": 0.4902191162109375,
      "learning_rate": 1.0919027437722513e-06,
      "loss": 0.0871,
      "mae_dtheta": 0.03214730694890022,
      "mae_dx": 0.009306552819907665,
      "mae_dy": 0.003648150945082307,
      "pose_mae_dtheta": 0.22193343937397003,
      "pose_mae_dx": 0.07582087814807892,
      "pose_mae_dy": 0.039466701447963715,
      "pose_rmse_dtheta": 0.3997272253036499,
      "pose_rmse_dx": 0.18191565573215485,
      "pose_rmse_dy": 0.12213760614395142,
      "pose_rmse_mean": 0.2345934957265854,
      "rmse_dtheta": 0.04802943393588066,
      "rmse_dx": 0.021895892918109894,
      "rmse_dy": 0.007281374651938677,
      "rmse_mean": 0.02573556825518608,
      "rotation_flip": 0.024390242993831635,
      "sparse_tokens": 6503.0,
      "step": 9454,
      "turn_loss": 0.22600078582763672,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.43927708604348636,
      "grad_norm": 0.4448671340942383,
      "learning_rate": 1.0910781388585834e-06,
      "loss": 0.1094,
      "mae_dtheta": 0.005131186917424202,
      "mae_dx": 0.0009170647826977074,
      "mae_dy": 0.0009999772300943732,
      "pose_mae_dtheta": 0.03571520745754242,
      "pose_mae_dx": 0.008949941024184227,
      "pose_mae_dy": 0.012488726526498795,
      "pose_rmse_dtheta": 0.09818287193775177,
      "pose_rmse_dx": 0.021977441385388374,
      "pose_rmse_dy": 0.03550862520933151,
      "pose_rmse_mean": 0.05188965052366257,
      "rmse_dtheta": 0.015365075320005417,
      "rmse_dx": 0.002638481790199876,
      "rmse_dy": 0.003281770972535014,
      "rmse_mean": 0.0070951092056930065,
      "rotation_flip": 0.001899335184134543,
      "sparse_tokens": 32137.0,
      "step": 9455,
      "turn_loss": 0.036299776285886765,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.43932354580932914,
      "grad_norm": 0.4922913908958435,
      "learning_rate": 1.0902538072979184e-06,
      "loss": 0.1455,
      "mae_dtheta": 0.04300936684012413,
      "mae_dx": 0.013905143365263939,
      "mae_dy": 0.008616830222308636,
      "pose_mae_dtheta": 0.3110656440258026,
      "pose_mae_dx": 0.11876790225505829,
      "pose_mae_dy": 0.08784757554531097,
      "pose_rmse_dtheta": 0.5163284540176392,
      "pose_rmse_dx": 0.24324558675289154,
      "pose_rmse_dy": 0.2314414083957672,
      "pose_rmse_mean": 0.3303384780883789,
      "rmse_dtheta": 0.05965244397521019,
      "rmse_dx": 0.025909127667546272,
      "rmse_dy": 0.017910204827785492,
      "rmse_mean": 0.034490592777729034,
      "rotation_flip": 0.0187134500592947,
      "sparse_tokens": 14564.0,
      "step": 9456,
      "turn_loss": 0.37488242983818054,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4393700055751719,
      "grad_norm": 0.6398389935493469,
      "learning_rate": 1.0894297491479044e-06,
      "loss": 0.1282,
      "mae_dtheta": 0.011628564447164536,
      "mae_dx": 0.004072666168212891,
      "mae_dy": 0.002586162416264415,
      "pose_mae_dtheta": 0.08085306733846664,
      "pose_mae_dx": 0.042271990329027176,
      "pose_mae_dy": 0.03391847014427185,
      "pose_rmse_dtheta": 0.17419901490211487,
      "pose_rmse_dx": 0.12579751014709473,
      "pose_rmse_dy": 0.07303518056869507,
      "pose_rmse_mean": 0.12434390187263489,
      "rmse_dtheta": 0.023032858967781067,
      "rmse_dx": 0.013102416880428791,
      "rmse_dy": 0.005552923306822777,
      "rmse_mean": 0.013896065764129162,
      "rotation_flip": 0.003348681377246976,
      "sparse_tokens": 32073.0,
      "step": 9457,
      "turn_loss": 0.15105795860290527,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4394164653410147,
      "grad_norm": 0.5867691040039062,
      "learning_rate": 1.0886059644661657e-06,
      "loss": 0.1124,
      "mae_dtheta": 0.010378376580774784,
      "mae_dx": 0.0012266291305422783,
      "mae_dy": 0.001681197783909738,
      "pose_mae_dtheta": 0.06975260376930237,
      "pose_mae_dx": 0.015766527503728867,
      "pose_mae_dy": 0.022874658927321434,
      "pose_rmse_dtheta": 0.20325538516044617,
      "pose_rmse_dx": 0.037699904292821884,
      "pose_rmse_dy": 0.0525200180709362,
      "pose_rmse_mean": 0.09782510250806808,
      "rmse_dtheta": 0.024848833680152893,
      "rmse_dx": 0.003875005291774869,
      "rmse_dy": 0.004029732197523117,
      "rmse_mean": 0.01091785728931427,
      "rotation_flip": 0.0040666935965418816,
      "sparse_tokens": 32105.0,
      "step": 9458,
      "turn_loss": 0.07650809735059738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.43946292510685747,
      "grad_norm": 0.40913304686546326,
      "learning_rate": 1.087782453310311e-06,
      "loss": 0.1213,
      "mae_dtheta": 0.010330602526664734,
      "mae_dx": 0.0012793359346687794,
      "mae_dy": 0.002518175635486841,
      "pose_mae_dtheta": 0.07145214825868607,
      "pose_mae_dx": 0.021010426804423332,
      "pose_mae_dy": 0.027363097295165062,
      "pose_rmse_dtheta": 0.18610700964927673,
      "pose_rmse_dx": 0.05635591223835945,
      "pose_rmse_dy": 0.06616702675819397,
      "pose_rmse_mean": 0.10287664830684662,
      "rmse_dtheta": 0.02285137213766575,
      "rmse_dx": 0.003575952723622322,
      "rmse_dy": 0.006110616959631443,
      "rmse_mean": 0.010845980606973171,
      "rotation_flip": 0.0035906643606722355,
      "sparse_tokens": 32089.0,
      "step": 9459,
      "turn_loss": 0.07890009880065918,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.43950938487270025,
      "grad_norm": 0.36382728815078735,
      "learning_rate": 1.0869592157379305e-06,
      "loss": 0.0949,
      "mae_dtheta": 0.00936572439968586,
      "mae_dx": 0.00116094877012074,
      "mae_dy": 0.0017890656599774957,
      "pose_mae_dtheta": 0.05509999021887779,
      "pose_mae_dx": 0.01615062542259693,
      "pose_mae_dy": 0.022259440273046494,
      "pose_rmse_dtheta": 0.1186424121260643,
      "pose_rmse_dx": 0.036612629890441895,
      "pose_rmse_dy": 0.04776155576109886,
      "pose_rmse_mean": 0.06767220795154572,
      "rmse_dtheta": 0.019052114337682724,
      "rmse_dx": 0.0031681021209806204,
      "rmse_dy": 0.0034161321818828583,
      "rmse_mean": 0.008545449934899807,
      "rotation_flip": 0.003218884114176035,
      "sparse_tokens": 32137.0,
      "step": 9460,
      "turn_loss": 0.07645397633314133,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.439555844638543,
      "grad_norm": 0.5801597237586975,
      "learning_rate": 1.0861362518065915e-06,
      "loss": 0.1254,
      "mae_dtheta": 0.011917351745069027,
      "mae_dx": 0.0015533779514953494,
      "mae_dy": 0.0024049163330346346,
      "pose_mae_dtheta": 0.08321322500705719,
      "pose_mae_dx": 0.01737367920577526,
      "pose_mae_dy": 0.02551271952688694,
      "pose_rmse_dtheta": 0.24034246802330017,
      "pose_rmse_dx": 0.03804953396320343,
      "pose_rmse_dy": 0.06310051679611206,
      "pose_rmse_mean": 0.11383084952831268,
      "rmse_dtheta": 0.027241751551628113,
      "rmse_dx": 0.004137910902500153,
      "rmse_dy": 0.005483668297529221,
      "rmse_mean": 0.012287776917219162,
      "rotation_flip": 0.004213483072817326,
      "sparse_tokens": 32153.0,
      "step": 9461,
      "turn_loss": 0.0894722193479538,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4396023044043858,
      "grad_norm": 0.3712753355503082,
      "learning_rate": 1.0853135615738457e-06,
      "loss": 0.0762,
      "mae_dtheta": 0.011153247207403183,
      "mae_dx": 0.0018373287748545408,
      "mae_dy": 0.002898294012993574,
      "pose_mae_dtheta": 0.07528635114431381,
      "pose_mae_dx": 0.025134162977337837,
      "pose_mae_dy": 0.026496201753616333,
      "pose_rmse_dtheta": 0.1943592131137848,
      "pose_rmse_dx": 0.06947735697031021,
      "pose_rmse_dy": 0.060912080109119415,
      "pose_rmse_mean": 0.10824954509735107,
      "rmse_dtheta": 0.02379201538860798,
      "rmse_dx": 0.005229712929576635,
      "rmse_dy": 0.006648643407970667,
      "rmse_mean": 0.011890124529600143,
      "rotation_flip": 0.0033469691406935453,
      "sparse_tokens": 32105.0,
      "step": 9462,
      "turn_loss": 0.09104931354522705,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4396487641702286,
      "grad_norm": 0.42199602723121643,
      "learning_rate": 1.0844911450972228e-06,
      "loss": 0.0899,
      "mae_dtheta": 0.010715111158788204,
      "mae_dx": 0.0013065371895208955,
      "mae_dy": 0.002257021376863122,
      "pose_mae_dtheta": 0.06914184987545013,
      "pose_mae_dx": 0.019855033606290817,
      "pose_mae_dy": 0.028994245454669,
      "pose_rmse_dtheta": 0.15465444326400757,
      "pose_rmse_dx": 0.05407876893877983,
      "pose_rmse_dy": 0.06972146779298782,
      "pose_rmse_mean": 0.0928182303905487,
      "rmse_dtheta": 0.021865924820303917,
      "rmse_dx": 0.0034337576944381,
      "rmse_dy": 0.0046174065209925175,
      "rmse_mean": 0.009972363710403442,
      "rotation_flip": 0.009511456824839115,
      "sparse_tokens": 32105.0,
      "step": 9463,
      "turn_loss": 0.09705732017755508,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.43969522393607136,
      "grad_norm": 0.5030174255371094,
      "learning_rate": 1.0836690024342373e-06,
      "loss": 0.1351,
      "mae_dtheta": 0.032760459929704666,
      "mae_dx": 0.006932938937097788,
      "mae_dy": 0.005635347682982683,
      "pose_mae_dtheta": 0.2569102942943573,
      "pose_mae_dx": 0.07416120916604996,
      "pose_mae_dy": 0.0654056966304779,
      "pose_rmse_dtheta": 0.4182750880718231,
      "pose_rmse_dx": 0.16888876259326935,
      "pose_rmse_dy": 0.15283872187137604,
      "pose_rmse_mean": 0.2466675341129303,
      "rmse_dtheta": 0.049453072249889374,
      "rmse_dx": 0.015448862686753273,
      "rmse_dy": 0.010825294069945812,
      "rmse_mean": 0.025242408737540245,
      "rotation_flip": 0.01287553645670414,
      "sparse_tokens": 3948.0,
      "step": 9464,
      "turn_loss": 0.256917268037796,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.43974168370191413,
      "grad_norm": 0.6257485151290894,
      "learning_rate": 1.0828471336423786e-06,
      "loss": 0.1738,
      "mae_dtheta": 0.030607441440224648,
      "mae_dx": 0.010358787141740322,
      "mae_dy": 0.00807444378733635,
      "pose_mae_dtheta": 0.167509987950325,
      "pose_mae_dx": 0.07500843703746796,
      "pose_mae_dy": 0.0761127844452858,
      "pose_rmse_dtheta": 0.32607540488243103,
      "pose_rmse_dx": 0.15792952477931976,
      "pose_rmse_dy": 0.14695408940315247,
      "pose_rmse_mean": 0.21031968295574188,
      "rmse_dtheta": 0.04951935261487961,
      "rmse_dx": 0.02220010571181774,
      "rmse_dy": 0.015547904185950756,
      "rmse_mean": 0.029089121147990227,
      "rotation_flip": 0.028248587623238564,
      "sparse_tokens": 6678.0,
      "step": 9465,
      "turn_loss": 0.3416980504989624,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4397881434677569,
      "grad_norm": 0.4016566574573517,
      "learning_rate": 1.082025538779124e-06,
      "loss": 0.0934,
      "mae_dtheta": 0.007229483686387539,
      "mae_dx": 0.0011161142028868198,
      "mae_dy": 0.0021197814494371414,
      "pose_mae_dtheta": 0.04836128652095795,
      "pose_mae_dx": 0.019324949011206627,
      "pose_mae_dy": 0.02500423975288868,
      "pose_rmse_dtheta": 0.10821317136287689,
      "pose_rmse_dx": 0.05803609639406204,
      "pose_rmse_dy": 0.06384685635566711,
      "pose_rmse_mean": 0.07669871300458908,
      "rmse_dtheta": 0.015872731804847717,
      "rmse_dx": 0.0031349649652838707,
      "rmse_dy": 0.00486085657030344,
      "rmse_mean": 0.007956184446811676,
      "rotation_flip": 0.004642525687813759,
      "sparse_tokens": 32041.0,
      "step": 9466,
      "turn_loss": 0.06241615489125252,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.4398346032335997,
      "grad_norm": 0.4761354625225067,
      "learning_rate": 1.081204217901925e-06,
      "loss": 0.1072,
      "mae_dtheta": 0.03142927214503288,
      "mae_dx": 0.011369824409484863,
      "mae_dy": 0.007488283794373274,
      "pose_mae_dtheta": 0.2380826622247696,
      "pose_mae_dx": 0.08387753367424011,
      "pose_mae_dy": 0.08311159908771515,
      "pose_rmse_dtheta": 0.42705345153808594,
      "pose_rmse_dx": 0.2003801316022873,
      "pose_rmse_dy": 0.20665346086025238,
      "pose_rmse_mean": 0.27802902460098267,
      "rmse_dtheta": 0.0509299598634243,
      "rmse_dx": 0.024211283773183823,
      "rmse_dy": 0.01590549759566784,
      "rmse_mean": 0.030348915606737137,
      "rotation_flip": 0.02144249528646469,
      "sparse_tokens": 8093.0,
      "step": 9467,
      "turn_loss": 0.3456701338291168,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.43988106299944246,
      "grad_norm": 0.37419918179512024,
      "learning_rate": 1.0803831710682195e-06,
      "loss": 0.0942,
      "mae_dtheta": 0.008234784007072449,
      "mae_dx": 0.0015866621397435665,
      "mae_dy": 0.0015996810980141163,
      "pose_mae_dtheta": 0.055325038731098175,
      "pose_mae_dx": 0.014974608086049557,
      "pose_mae_dy": 0.020094482228159904,
      "pose_rmse_dtheta": 0.1380869299173355,
      "pose_rmse_dx": 0.036405112594366074,
      "pose_rmse_dy": 0.04624534025788307,
      "pose_rmse_mean": 0.07357913255691528,
      "rmse_dtheta": 0.018927205353975296,
      "rmse_dx": 0.004283845890313387,
      "rmse_dy": 0.0037885517813265324,
      "rmse_mean": 0.008999867364764214,
      "rotation_flip": 0.00365408044308424,
      "sparse_tokens": 32153.0,
      "step": 9468,
      "turn_loss": 0.06753087788820267,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.43992752276528524,
      "grad_norm": 0.4962165951728821,
      "learning_rate": 1.0795623983354214e-06,
      "loss": 0.0824,
      "mae_dtheta": 0.008589021861553192,
      "mae_dx": 0.000994306756183505,
      "mae_dy": 0.0013448912650346756,
      "pose_mae_dtheta": 0.05947185307741165,
      "pose_mae_dx": 0.013690990395843983,
      "pose_mae_dy": 0.01719825528562069,
      "pose_rmse_dtheta": 0.22401009500026703,
      "pose_rmse_dx": 0.04275404289364815,
      "pose_rmse_dy": 0.04556477442383766,
      "pose_rmse_mean": 0.10410963743925095,
      "rmse_dtheta": 0.02594597637653351,
      "rmse_dx": 0.0034427372738718987,
      "rmse_dy": 0.0038023749366402626,
      "rmse_mean": 0.011063696816563606,
      "rotation_flip": 0.0044868201948702335,
      "sparse_tokens": 32057.0,
      "step": 9469,
      "turn_loss": 0.05439862236380577,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.439973982531128,
      "grad_norm": 0.47858819365501404,
      "learning_rate": 1.0787418997609306e-06,
      "loss": 0.0797,
      "mae_dtheta": 0.010928269475698471,
      "mae_dx": 0.002022677566856146,
      "mae_dy": 0.002815095940604806,
      "pose_mae_dtheta": 0.0739908218383789,
      "pose_mae_dx": 0.015044131316244602,
      "pose_mae_dy": 0.021455198526382446,
      "pose_rmse_dtheta": 0.21509677171707153,
      "pose_rmse_dx": 0.04344707354903221,
      "pose_rmse_dy": 0.07171197980642319,
      "pose_rmse_mean": 0.11008527874946594,
      "rmse_dtheta": 0.028750143945217133,
      "rmse_dx": 0.005954182706773281,
      "rmse_dy": 0.008910194039344788,
      "rmse_mean": 0.014538174495100975,
      "rotation_flip": 0.008440692909061909,
      "sparse_tokens": 32153.0,
      "step": 9470,
      "turn_loss": 0.11363944411277771,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16241.0,
      "epoch": 0.44002044229697085,
      "grad_norm": 0.5073806047439575,
      "learning_rate": 1.0779216754021215e-06,
      "loss": 0.1536,
      "mae_dtheta": 0.028961464762687683,
      "mae_dx": 0.01126087922602892,
      "mae_dy": 0.0030739367939531803,
      "pose_mae_dtheta": 0.235338494181633,
      "pose_mae_dx": 0.07517130672931671,
      "pose_mae_dy": 0.039199866354465485,
      "pose_rmse_dtheta": 0.44900277256965637,
      "pose_rmse_dx": 0.18649637699127197,
      "pose_rmse_dy": 0.10773923248052597,
      "pose_rmse_mean": 0.24774610996246338,
      "rmse_dtheta": 0.04830526188015938,
      "rmse_dx": 0.02386600151658058,
      "rmse_dy": 0.007118882145732641,
      "rmse_mean": 0.026430048048496246,
      "rotation_flip": 0.01664145290851593,
      "sparse_tokens": 12952.0,
      "step": 9471,
      "turn_loss": 0.20564033091068268,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4400669020628136,
      "grad_norm": 0.5394097566604614,
      "learning_rate": 1.0771017253163569e-06,
      "loss": 0.14,
      "mae_dtheta": 0.00776014756411314,
      "mae_dx": 0.0014539873227477074,
      "mae_dy": 0.0015792023623362184,
      "pose_mae_dtheta": 0.04679419472813606,
      "pose_mae_dx": 0.016705600544810295,
      "pose_mae_dy": 0.020756550133228302,
      "pose_rmse_dtheta": 0.11835294961929321,
      "pose_rmse_dx": 0.06643122434616089,
      "pose_rmse_dy": 0.05258745700120926,
      "pose_rmse_mean": 0.07912387698888779,
      "rmse_dtheta": 0.017953703179955482,
      "rmse_dx": 0.005875385366380215,
      "rmse_dy": 0.004091679118573666,
      "rmse_mean": 0.009306922554969788,
      "rotation_flip": 0.0018091361271217465,
      "sparse_tokens": 32073.0,
      "step": 9472,
      "turn_loss": 0.0763087347149849,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.4401133618286564,
      "grad_norm": 0.4812929034233093,
      "learning_rate": 1.076282049560972e-06,
      "loss": 0.1494,
      "mae_dtheta": 0.037415873259305954,
      "mae_dx": 0.007791339885443449,
      "mae_dy": 0.007386678829789162,
      "pose_mae_dtheta": 0.26118406653404236,
      "pose_mae_dx": 0.07198144495487213,
      "pose_mae_dy": 0.09888118505477905,
      "pose_rmse_dtheta": 0.5028040409088135,
      "pose_rmse_dx": 0.1906527876853943,
      "pose_rmse_dy": 0.1978675276041031,
      "pose_rmse_mean": 0.29710811376571655,
      "rmse_dtheta": 0.056711502373218536,
      "rmse_dx": 0.0195677001029253,
      "rmse_dy": 0.012585647404193878,
      "rmse_mean": 0.029621616005897522,
      "rotation_flip": 0.0071428571827709675,
      "sparse_tokens": 8741.0,
      "step": 9473,
      "turn_loss": 0.2636459767818451,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4401598215944992,
      "grad_norm": 0.826299250125885,
      "learning_rate": 1.0754626481932918e-06,
      "loss": 0.1168,
      "mae_dtheta": 0.010235561989247799,
      "mae_dx": 0.0018117023864760995,
      "mae_dy": 0.0029559454414993525,
      "pose_mae_dtheta": 0.07306987792253494,
      "pose_mae_dx": 0.02522611990571022,
      "pose_mae_dy": 0.032186359167099,
      "pose_rmse_dtheta": 0.19987763464450836,
      "pose_rmse_dx": 0.06491737812757492,
      "pose_rmse_dy": 0.07770489156246185,
      "pose_rmse_mean": 0.11416663974523544,
      "rmse_dtheta": 0.023280825465917587,
      "rmse_dx": 0.005268585868179798,
      "rmse_dy": 0.006741918157786131,
      "rmse_mean": 0.011763776652514935,
      "rotation_flip": 0.0026256563141942024,
      "sparse_tokens": 32137.0,
      "step": 9474,
      "turn_loss": 0.09341950714588165,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.44020628136034196,
      "grad_norm": 0.610223114490509,
      "learning_rate": 1.0746435212706125e-06,
      "loss": 0.0927,
      "mae_dtheta": 0.009019955061376095,
      "mae_dx": 0.003150913631543517,
      "mae_dy": 0.0018940138397738338,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6102232336997986,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 171.47714233398438,
      "model/head/act_norm_mean": 119.27260890151516,
      "model/head/act_norm_min": 55.423316955566406,
      "model/head/act_over_embed": 81.96525348487883,
      "model/head/grad_frac": 0.09351237863302231,
      "model/head/grad_norm": 0.057063426822423935,
      "model/head/grad_zero_frac": 0.00015800134860910475,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7109917534722222,
      "model/head/update_ratio": 0.0009715772466734052,
      "model/head/weight_delta": 9.910839080810547,
      "model/head/weight_delta_rel": 0.17386546730995178,
      "model/head/weight_norm": 58.73277282714844,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42280980944633484,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42272235959075216,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226513206958771,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29049876309984823,
      "model/modality_embedder.encoders.pose/grad_frac": 0.15921548008918762,
      "model/modality_embedder.encoders.pose/grad_norm": 0.09715698659420013,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5317132994186047,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0031372113153338432,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1400787830352783,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10259616374969482,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969219207763672,
      "model/modality_embedder/grad_frac": 0.15921548008918762,
      "model/modality_embedder/grad_norm": 0.09715698659420013,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5317132994186047,
      "model/modality_embedder/update_ratio": 0.0031372113153338432,
      "model/modality_embedder/weight_delta": 3.1400787830352783,
      "model/modality_embedder/weight_delta_rel": 0.10259616374969482,
      "model/modality_embedder/weight_norm": 30.969219207763672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 93.756103515625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.465388007054674,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.04137134552002,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.812843687019214,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06734400242567062,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04109487682580948,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014701782492920756,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7025609016418457,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09848295152187347,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.952308654785156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 95.02574920654297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.41063912938913,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.207639694213867,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.462429107867884,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06408647447824478,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.039107054471969604,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013142277020961046,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.426870822906494,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11870948225259781,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.756681442260742,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 96.51895904541016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.181467452300787,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.29269790649414,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.679358910128737,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06147615239024162,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03751417621970177,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012208877597004175,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.710088014602661,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12457780539989471,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.726964950561523,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.94249725341797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.84587942921276,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.931005477905273,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.823158403133082,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.061147745698690414,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03731377422809601,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012461396399885416,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.186164379119873,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10888797789812088,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.943492889404297,
      "model/normalizer/grad_frac": 0.24444548785686493,
      "model/normalizer/grad_norm": 0.1491663157939911,
      "model/normalizer/grad_zero_frac": 0.0001737155398586765,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018967788200825453,
      "model/normalizer/weight_delta": 6.70716667175293,
      "model/normalizer/weight_delta_rel": 0.08638442307710648,
      "model/normalizer/weight_norm": 78.64191436767578,
      "pose_mae_dtheta": 0.06132293492555618,
      "pose_mae_dx": 0.028265254572033882,
      "pose_mae_dy": 0.027997829020023346,
      "pose_rmse_dtheta": 0.18799692392349243,
      "pose_rmse_dx": 0.1026466116309166,
      "pose_rmse_dy": 0.08880889415740967,
      "pose_rmse_mean": 0.12648415565490723,
      "rmse_dtheta": 0.022672658786177635,
      "rmse_dx": 0.01203901693224907,
      "rmse_dy": 0.005434331484138966,
      "rmse_mean": 0.013382001779973507,
      "rotation_flip": 0.00390625,
      "sparse_tokens": 32041.0,
      "step": 9475,
      "turn_loss": 0.10878809541463852,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.44025274112618473,
      "grad_norm": 0.8382735252380371,
      "learning_rate": 1.0738246688502207e-06,
      "loss": 0.1612,
      "mae_dtheta": 0.028987467288970947,
      "mae_dx": 0.014075194485485554,
      "mae_dy": 0.003607422113418579,
      "pose_mae_dtheta": 0.22628645598888397,
      "pose_mae_dx": 0.10827817022800446,
      "pose_mae_dy": 0.039956606924533844,
      "pose_rmse_dtheta": 0.4394587278366089,
      "pose_rmse_dx": 0.2397308647632599,
      "pose_rmse_dy": 0.09895338118076324,
      "pose_rmse_mean": 0.2593809962272644,
      "rmse_dtheta": 0.04880576953291893,
      "rmse_dx": 0.02719699591398239,
      "rmse_dy": 0.00781487487256527,
      "rmse_mean": 0.027939213439822197,
      "rotation_flip": 0.01011804398149252,
      "sparse_tokens": 12107.0,
      "step": 9476,
      "turn_loss": 0.19759908318519592,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4402992008920275,
      "grad_norm": 0.4898577630519867,
      "learning_rate": 1.0730060909893758e-06,
      "loss": 0.1138,
      "mae_dtheta": 0.006771399639546871,
      "mae_dx": 0.0018336036009714007,
      "mae_dy": 0.0015245393151417375,
      "pose_mae_dtheta": 0.04375853389501572,
      "pose_mae_dx": 0.017031824216246605,
      "pose_mae_dy": 0.0149344801902771,
      "pose_rmse_dtheta": 0.14012041687965393,
      "pose_rmse_dx": 0.04315676540136337,
      "pose_rmse_dy": 0.03455524891614914,
      "pose_rmse_mean": 0.07261081784963608,
      "rmse_dtheta": 0.01892176829278469,
      "rmse_dx": 0.00573336984962225,
      "rmse_dy": 0.0035735792480409145,
      "rmse_mean": 0.009409572929143906,
      "rotation_flip": 0.0040774717926979065,
      "sparse_tokens": 32121.0,
      "step": 9477,
      "turn_loss": 0.07459183782339096,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4403456606578703,
      "grad_norm": 0.6909735202789307,
      "learning_rate": 1.0721877877453224e-06,
      "loss": 0.1316,
      "mae_dtheta": 0.006482277065515518,
      "mae_dx": 0.001476247445680201,
      "mae_dy": 0.0014854150358587503,
      "pose_mae_dtheta": 0.04331981763243675,
      "pose_mae_dx": 0.01596696488559246,
      "pose_mae_dy": 0.018141232430934906,
      "pose_rmse_dtheta": 0.10444792360067368,
      "pose_rmse_dx": 0.04045233502984047,
      "pose_rmse_dy": 0.05160275474190712,
      "pose_rmse_mean": 0.06550100445747375,
      "rmse_dtheta": 0.016705909743905067,
      "rmse_dx": 0.004309804178774357,
      "rmse_dy": 0.003955650143325329,
      "rmse_mean": 0.0083237886428833,
      "rotation_flip": 0.0014402304077520967,
      "sparse_tokens": 32105.0,
      "step": 9478,
      "turn_loss": 0.058665912598371506,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.44039212042371306,
      "grad_norm": 0.4995477795600891,
      "learning_rate": 1.0713697591752864e-06,
      "loss": 0.1304,
      "mae_dtheta": 0.03003397211432457,
      "mae_dx": 0.010477990843355656,
      "mae_dy": 0.0063994149677455425,
      "pose_mae_dtheta": 0.2251443713903427,
      "pose_mae_dx": 0.08254515379667282,
      "pose_mae_dy": 0.08129016309976578,
      "pose_rmse_dtheta": 0.39633050560951233,
      "pose_rmse_dx": 0.17481695115566254,
      "pose_rmse_dy": 0.1739036738872528,
      "pose_rmse_mean": 0.2483503818511963,
      "rmse_dtheta": 0.047278162091970444,
      "rmse_dx": 0.02300396002829075,
      "rmse_dy": 0.010885818861424923,
      "rmse_mean": 0.027055982500314713,
      "rotation_flip": 0.012356575578451157,
      "sparse_tokens": 17807.0,
      "step": 9479,
      "turn_loss": 0.2386070340871811,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.44043858018955584,
      "grad_norm": 0.48177120089530945,
      "learning_rate": 1.070552005336471e-06,
      "loss": 0.0987,
      "mae_dtheta": 0.007018133997917175,
      "mae_dx": 0.001246708445250988,
      "mae_dy": 0.0002034360950347036,
      "pose_mae_dtheta": 0.04627910628914833,
      "pose_mae_dx": 0.009198508225381374,
      "pose_mae_dy": 0.0028048790991306305,
      "pose_rmse_dtheta": 0.2046317607164383,
      "pose_rmse_dx": 0.01955907978117466,
      "pose_rmse_dy": 0.005538284778594971,
      "pose_rmse_mean": 0.07657638192176819,
      "rmse_dtheta": 0.026971442624926567,
      "rmse_dx": 0.003245984436944127,
      "rmse_dy": 0.0004732515662908554,
      "rmse_mean": 0.010230226442217827,
      "rotation_flip": 0.001704545458778739,
      "sparse_tokens": 32233.0,
      "step": 9480,
      "turn_loss": 0.04142218083143234,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4404850399553986,
      "grad_norm": 0.41634899377822876,
      "learning_rate": 1.0697345262860638e-06,
      "loss": 0.1279,
      "mae_dtheta": 0.009541523642838001,
      "mae_dx": 0.0017080842517316341,
      "mae_dy": 0.0015462717274203897,
      "pose_mae_dtheta": 0.0695333480834961,
      "pose_mae_dx": 0.018975554034113884,
      "pose_mae_dy": 0.024087507277727127,
      "pose_rmse_dtheta": 0.19783949851989746,
      "pose_rmse_dx": 0.05386411398649216,
      "pose_rmse_dy": 0.056162670254707336,
      "pose_rmse_mean": 0.10262209177017212,
      "rmse_dtheta": 0.02478662319481373,
      "rmse_dx": 0.005810653790831566,
      "rmse_dy": 0.003528701374307275,
      "rmse_mean": 0.011375326663255692,
      "rotation_flip": 0.005386875476688147,
      "sparse_tokens": 32089.0,
      "step": 9481,
      "turn_loss": 0.08369337767362595,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.4405314997212414,
      "grad_norm": 0.6224582195281982,
      "learning_rate": 1.0689173220812294e-06,
      "loss": 0.1157,
      "mae_dtheta": 0.042547933757305145,
      "mae_dx": 0.013789425604045391,
      "mae_dy": 0.00923378486186266,
      "pose_mae_dtheta": 0.32567790150642395,
      "pose_mae_dx": 0.10529518127441406,
      "pose_mae_dy": 0.10354959219694138,
      "pose_rmse_dtheta": 0.5565381646156311,
      "pose_rmse_dx": 0.2104867845773697,
      "pose_rmse_dy": 0.2754345238208771,
      "pose_rmse_mean": 0.3474864959716797,
      "rmse_dtheta": 0.061379142105579376,
      "rmse_dx": 0.026216546073555946,
      "rmse_dy": 0.01779073290526867,
      "rmse_mean": 0.03512880951166153,
      "rotation_flip": 0.027480915188789368,
      "sparse_tokens": 10259.0,
      "step": 9482,
      "turn_loss": 0.325115829706192,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.44057795948708417,
      "grad_norm": 0.5850982666015625,
      "learning_rate": 1.0681003927791178e-06,
      "loss": 0.1721,
      "mae_dtheta": 0.02294153906404972,
      "mae_dx": 0.007966122590005398,
      "mae_dy": 0.00317085231654346,
      "pose_mae_dtheta": 0.16297252476215363,
      "pose_mae_dx": 0.06658102571964264,
      "pose_mae_dy": 0.04659415781497955,
      "pose_rmse_dtheta": 0.3020695745944977,
      "pose_rmse_dx": 0.16706757247447968,
      "pose_rmse_dy": 0.11132024973630905,
      "pose_rmse_mean": 0.1934857964515686,
      "rmse_dtheta": 0.0390692800283432,
      "rmse_dx": 0.01958240196108818,
      "rmse_dy": 0.0057295821607112885,
      "rmse_mean": 0.02146042138338089,
      "rotation_flip": 0.005018820520490408,
      "sparse_tokens": 16458.0,
      "step": 9483,
      "turn_loss": 0.1933356374502182,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.44062441925292695,
      "grad_norm": 0.6958633661270142,
      "learning_rate": 1.0672837384368551e-06,
      "loss": 0.1718,
      "mae_dtheta": 0.03028157167136669,
      "mae_dx": 0.006304682698100805,
      "mae_dy": 0.00199419679120183,
      "pose_mae_dtheta": 0.21820852160453796,
      "pose_mae_dx": 0.045680318027734756,
      "pose_mae_dy": 0.028028512373566628,
      "pose_rmse_dtheta": 0.42364785075187683,
      "pose_rmse_dx": 0.13770830631256104,
      "pose_rmse_dy": 0.07870414853096008,
      "pose_rmse_mean": 0.21335344016551971,
      "rmse_dtheta": 0.05077581852674484,
      "rmse_dx": 0.017251543700695038,
      "rmse_dy": 0.005876871757209301,
      "rmse_mean": 0.024634744971990585,
      "rotation_flip": 0.004545454401522875,
      "sparse_tokens": 12158.0,
      "step": 9484,
      "turn_loss": 0.17776398360729218,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4406708790187697,
      "grad_norm": 0.5476018190383911,
      "learning_rate": 1.0664673591115514e-06,
      "loss": 0.1144,
      "mae_dtheta": 0.010936494916677475,
      "mae_dx": 0.0014237590366974473,
      "mae_dy": 0.002363416599109769,
      "pose_mae_dtheta": 0.07600270956754684,
      "pose_mae_dx": 0.022446533665060997,
      "pose_mae_dy": 0.030910687521100044,
      "pose_rmse_dtheta": 0.18389742076396942,
      "pose_rmse_dx": 0.056972868740558624,
      "pose_rmse_dy": 0.07844195514917374,
      "pose_rmse_mean": 0.10643741488456726,
      "rmse_dtheta": 0.02210446260869503,
      "rmse_dx": 0.0039327386766672134,
      "rmse_dy": 0.005014531314373016,
      "rmse_mean": 0.010350577533245087,
      "rotation_flip": 0.0036088055931031704,
      "sparse_tokens": 32089.0,
      "step": 9485,
      "turn_loss": 0.08090092241764069,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4407173387846125,
      "grad_norm": 0.40005478262901306,
      "learning_rate": 1.0656512548602977e-06,
      "loss": 0.0822,
      "mae_dtheta": 0.00648461002856493,
      "mae_dx": 0.0013517180923372507,
      "mae_dy": 0.0014320116024464369,
      "pose_mae_dtheta": 0.04578901082277298,
      "pose_mae_dx": 0.0136099923402071,
      "pose_mae_dy": 0.016907405108213425,
      "pose_rmse_dtheta": 0.116526298224926,
      "pose_rmse_dx": 0.036658819764852524,
      "pose_rmse_dy": 0.04370855167508125,
      "pose_rmse_mean": 0.06563122570514679,
      "rmse_dtheta": 0.016649581491947174,
      "rmse_dx": 0.004331809934228659,
      "rmse_dy": 0.004305628594011068,
      "rmse_mean": 0.008429007604718208,
      "rotation_flip": 0.0031529164407402277,
      "sparse_tokens": 32105.0,
      "step": 9486,
      "turn_loss": 0.053589724004268646,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.44076379855045533,
      "grad_norm": 0.5537076592445374,
      "learning_rate": 1.0648354257401622e-06,
      "loss": 0.1585,
      "mae_dtheta": 0.011113622225821018,
      "mae_dx": 0.002684172010049224,
      "mae_dy": 0.003571535926312208,
      "pose_mae_dtheta": 0.07268936932086945,
      "pose_mae_dx": 0.031127549707889557,
      "pose_mae_dy": 0.033064208924770355,
      "pose_rmse_dtheta": 0.14504222571849823,
      "pose_rmse_dx": 0.08270543068647385,
      "pose_rmse_dy": 0.0753842294216156,
      "pose_rmse_mean": 0.10104396194219589,
      "rmse_dtheta": 0.02151876501739025,
      "rmse_dx": 0.007267639972269535,
      "rmse_dy": 0.007285055238753557,
      "rmse_mean": 0.012023820541799068,
      "rotation_flip": 0.009523809887468815,
      "sparse_tokens": 32121.0,
      "step": 9487,
      "turn_loss": 0.10758849233388901,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4408102583162981,
      "grad_norm": 0.6777294874191284,
      "learning_rate": 1.064019871808199e-06,
      "loss": 0.1442,
      "mae_dtheta": 0.009717335924506187,
      "mae_dx": 0.0014887690776959062,
      "mae_dy": 0.002768242498859763,
      "pose_mae_dtheta": 0.06500615179538727,
      "pose_mae_dx": 0.02265114337205887,
      "pose_mae_dy": 0.030212905257940292,
      "pose_rmse_dtheta": 0.1275153011083603,
      "pose_rmse_dx": 0.05770587921142578,
      "pose_rmse_dy": 0.06590969860553741,
      "pose_rmse_mean": 0.08371029794216156,
      "rmse_dtheta": 0.01888258382678032,
      "rmse_dx": 0.0039774454198777676,
      "rmse_dy": 0.005941924173384905,
      "rmse_mean": 0.009600651450455189,
      "rotation_flip": 0.002168413484469056,
      "sparse_tokens": 32105.0,
      "step": 9488,
      "turn_loss": 0.08202332258224487,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.4408567180821409,
      "grad_norm": 0.6090878844261169,
      "learning_rate": 1.0632045931214369e-06,
      "loss": 0.1647,
      "mae_dtheta": 0.022719670087099075,
      "mae_dx": 0.010809279046952724,
      "mae_dy": 0.004947990644723177,
      "pose_mae_dtheta": 0.14238296449184418,
      "pose_mae_dx": 0.08695532381534576,
      "pose_mae_dy": 0.059727828949689865,
      "pose_rmse_dtheta": 0.24997149407863617,
      "pose_rmse_dx": 0.20540301501750946,
      "pose_rmse_dy": 0.12678730487823486,
      "pose_rmse_mean": 0.19405393302440643,
      "rmse_dtheta": 0.03686095401644707,
      "rmse_dx": 0.023383675143122673,
      "rmse_dy": 0.008772271685302258,
      "rmse_mean": 0.023005632683634758,
      "rotation_flip": 0.01796407252550125,
      "sparse_tokens": 8628.0,
      "step": 9489,
      "turn_loss": 0.24581032991409302,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 25311.0,
      "epoch": 0.44090317784798366,
      "grad_norm": 0.7245047688484192,
      "learning_rate": 1.0623895897368914e-06,
      "loss": 0.1445,
      "mae_dtheta": 0.03240958973765373,
      "mae_dx": 0.009297030977904797,
      "mae_dy": 0.003274637507274747,
      "pose_mae_dtheta": 0.22880783677101135,
      "pose_mae_dx": 0.07845132797956467,
      "pose_mae_dy": 0.043463993817567825,
      "pose_rmse_dtheta": 0.42272311449050903,
      "pose_rmse_dx": 0.18817831575870514,
      "pose_rmse_dy": 0.09547869861125946,
      "pose_rmse_mean": 0.2354600429534912,
      "rmse_dtheta": 0.050321999937295914,
      "rmse_dx": 0.02097281813621521,
      "rmse_dy": 0.006019227672368288,
      "rmse_mean": 0.02577134780585766,
      "rotation_flip": 0.017642341554164886,
      "sparse_tokens": 19495.0,
      "step": 9490,
      "turn_loss": 0.26294273138046265,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.44094963761382644,
      "grad_norm": 0.5444737672805786,
      "learning_rate": 1.0615748617115556e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.011704059317708015,
      "mae_dx": 0.0024686118122190237,
      "mae_dy": 0.002852903213351965,
      "pose_mae_dtheta": 0.07910460978746414,
      "pose_mae_dx": 0.027065418660640717,
      "pose_mae_dy": 0.027516106143593788,
      "pose_rmse_dtheta": 0.19928087294101715,
      "pose_rmse_dx": 0.07539183646440506,
      "pose_rmse_dy": 0.06706660240888596,
      "pose_rmse_mean": 0.11391311138868332,
      "rmse_dtheta": 0.026571745052933693,
      "rmse_dx": 0.006800336297601461,
      "rmse_dy": 0.006559731438755989,
      "rmse_mean": 0.01331060379743576,
      "rotation_flip": 0.00797390379011631,
      "sparse_tokens": 32121.0,
      "step": 9491,
      "turn_loss": 0.1149711161851883,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4409960973796692,
      "grad_norm": 0.2695249915122986,
      "learning_rate": 1.0607604091024032e-06,
      "loss": 0.0611,
      "mae_dtheta": 0.005426341202110052,
      "mae_dx": 0.0007911892025731504,
      "mae_dy": 0.0009207528200931847,
      "pose_mae_dtheta": 0.03425350412726402,
      "pose_mae_dx": 0.010084761306643486,
      "pose_mae_dy": 0.014314264059066772,
      "pose_rmse_dtheta": 0.08694780617952347,
      "pose_rmse_dx": 0.026760730892419815,
      "pose_rmse_dy": 0.03648851811885834,
      "pose_rmse_mean": 0.05006568878889084,
      "rmse_dtheta": 0.014424077235162258,
      "rmse_dx": 0.00258567463606596,
      "rmse_dy": 0.0022898605093359947,
      "rmse_mean": 0.006433203816413879,
      "rotation_flip": 0.002074688905850053,
      "sparse_tokens": 32089.0,
      "step": 9492,
      "turn_loss": 0.038486480712890625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.441042557145512,
      "grad_norm": 0.4149661362171173,
      "learning_rate": 1.0599462319663906e-06,
      "loss": 0.083,
      "mae_dtheta": 0.013563728891313076,
      "mae_dx": 0.002494798507541418,
      "mae_dy": 0.002440475858747959,
      "pose_mae_dtheta": 0.09370113909244537,
      "pose_mae_dx": 0.02058493345975876,
      "pose_mae_dy": 0.0236391332000494,
      "pose_rmse_dtheta": 0.2582707703113556,
      "pose_rmse_dx": 0.05136921629309654,
      "pose_rmse_dy": 0.05507262051105499,
      "pose_rmse_mean": 0.12157087028026581,
      "rmse_dtheta": 0.030043950304389,
      "rmse_dx": 0.007900585420429707,
      "rmse_dy": 0.007656298112124205,
      "rmse_mean": 0.015200278721749783,
      "rotation_flip": 0.00450635002925992,
      "sparse_tokens": 32121.0,
      "step": 9493,
      "turn_loss": 0.11353810876607895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.44108901691135477,
      "grad_norm": 0.5515347719192505,
      "learning_rate": 1.0591323303604516e-06,
      "loss": 0.1997,
      "mae_dtheta": 0.044632650911808014,
      "mae_dx": 0.015082831494510174,
      "mae_dy": 0.01744125410914421,
      "pose_mae_dtheta": 0.34868475794792175,
      "pose_mae_dx": 0.18642263114452362,
      "pose_mae_dy": 0.13332146406173706,
      "pose_rmse_dtheta": 0.6080237627029419,
      "pose_rmse_dx": 0.3450305759906769,
      "pose_rmse_dy": 0.3026721179485321,
      "pose_rmse_mean": 0.4185754954814911,
      "rmse_dtheta": 0.06150038167834282,
      "rmse_dx": 0.025345606729388237,
      "rmse_dy": 0.03180346265435219,
      "rmse_mean": 0.039549820125103,
      "rotation_flip": 0.02484472095966339,
      "sparse_tokens": 2997.0,
      "step": 9494,
      "turn_loss": 0.5165255665779114,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.44113547667719755,
      "grad_norm": 0.5056435465812683,
      "learning_rate": 1.0583187043415054e-06,
      "loss": 0.1129,
      "mae_dtheta": 0.010657243430614471,
      "mae_dx": 0.0021232974249869585,
      "mae_dy": 0.004265184979885817,
      "pose_mae_dtheta": 0.07082285732030869,
      "pose_mae_dx": 0.03166589513421059,
      "pose_mae_dy": 0.031001059338450432,
      "pose_rmse_dtheta": 0.15348628163337708,
      "pose_rmse_dx": 0.075299933552742,
      "pose_rmse_dy": 0.06226567551493645,
      "pose_rmse_mean": 0.097017303109169,
      "rmse_dtheta": 0.02086712047457695,
      "rmse_dx": 0.004627141170203686,
      "rmse_dy": 0.00867745652794838,
      "rmse_mean": 0.011390573345124722,
      "rotation_flip": 0.0032722512260079384,
      "sparse_tokens": 32121.0,
      "step": 9495,
      "turn_loss": 0.10822088271379471,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.4411819364430403,
      "grad_norm": 0.6235126256942749,
      "learning_rate": 1.0575053539664465e-06,
      "loss": 0.1718,
      "mae_dtheta": 0.027585070580244064,
      "mae_dx": 0.012965206056833267,
      "mae_dy": 0.006697523407638073,
      "pose_mae_dtheta": 0.1901417225599289,
      "pose_mae_dx": 0.1017439216375351,
      "pose_mae_dy": 0.12130388617515564,
      "pose_rmse_dtheta": 0.29392844438552856,
      "pose_rmse_dx": 0.2236364185810089,
      "pose_rmse_dy": 0.26163139939308167,
      "pose_rmse_mean": 0.25973209738731384,
      "rmse_dtheta": 0.04121766239404678,
      "rmse_dx": 0.02664966881275177,
      "rmse_dy": 0.0124733941629529,
      "rmse_mean": 0.02678024396300316,
      "rotation_flip": 0.009478673338890076,
      "sparse_tokens": 7429.0,
      "step": 9496,
      "turn_loss": 0.2616479992866516,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4412283962088831,
      "grad_norm": 0.3626333177089691,
      "learning_rate": 1.0566922792921536e-06,
      "loss": 0.1064,
      "mae_dtheta": 0.004461982287466526,
      "mae_dx": 0.0011223206529393792,
      "mae_dy": 0.0006081686588004231,
      "pose_mae_dtheta": 0.03227204829454422,
      "pose_mae_dx": 0.00836819689720869,
      "pose_mae_dy": 0.009534279815852642,
      "pose_rmse_dtheta": 0.10323960334062576,
      "pose_rmse_dx": 0.024578344076871872,
      "pose_rmse_dy": 0.028281932696700096,
      "pose_rmse_mean": 0.05203329026699066,
      "rmse_dtheta": 0.013837582431733608,
      "rmse_dx": 0.003965814132243395,
      "rmse_dy": 0.0013186691794544458,
      "rmse_mean": 0.006374021992087364,
      "rotation_flip": 0.0019512195140123367,
      "sparse_tokens": 32185.0,
      "step": 9497,
      "turn_loss": 0.033342983573675156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4412748559747259,
      "grad_norm": 0.46071645617485046,
      "learning_rate": 1.055879480375488e-06,
      "loss": 0.133,
      "mae_dtheta": 0.014850636012852192,
      "mae_dx": 0.0026155158411711454,
      "mae_dy": 0.0037589124403893948,
      "pose_mae_dtheta": 0.10518497973680496,
      "pose_mae_dx": 0.0323496051132679,
      "pose_mae_dy": 0.0367501825094223,
      "pose_rmse_dtheta": 0.2673303484916687,
      "pose_rmse_dx": 0.07453277707099915,
      "pose_rmse_dy": 0.07523779571056366,
      "pose_rmse_mean": 0.13903364539146423,
      "rmse_dtheta": 0.029847536236047745,
      "rmse_dx": 0.008455092087388039,
      "rmse_dy": 0.009436248801648617,
      "rmse_mean": 0.015912961214780807,
      "rotation_flip": 0.0041551245376467705,
      "sparse_tokens": 32073.0,
      "step": 9498,
      "turn_loss": 0.12886705994606018,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.44132131574056865,
      "grad_norm": 0.4775024652481079,
      "learning_rate": 1.0550669572732862e-06,
      "loss": 0.1082,
      "mae_dtheta": 0.007090011611580849,
      "mae_dx": 0.0013975758338347077,
      "mae_dy": 0.0014250252861529589,
      "pose_mae_dtheta": 0.04783114790916443,
      "pose_mae_dx": 0.015496599487960339,
      "pose_mae_dy": 0.01719851978123188,
      "pose_rmse_dtheta": 0.13842245936393738,
      "pose_rmse_dx": 0.03830890730023384,
      "pose_rmse_dy": 0.04818011820316315,
      "pose_rmse_mean": 0.07497049868106842,
      "rmse_dtheta": 0.018295016139745712,
      "rmse_dx": 0.0042848167940974236,
      "rmse_dy": 0.003854673355817795,
      "rmse_mean": 0.00881150271743536,
      "rotation_flip": 0.0045615811832249165,
      "sparse_tokens": 32121.0,
      "step": 9499,
      "turn_loss": 0.06127820909023285,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.44136777550641143,
      "grad_norm": 0.7386382222175598,
      "learning_rate": 1.0542547100423705e-06,
      "loss": 0.1677,
      "mae_dtheta": 0.03351384028792381,
      "mae_dx": 0.005581970326602459,
      "mae_dy": 0.003876783885061741,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7386383414268494,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 148.5489044189453,
      "model/head/act_norm_mean": 106.0079911394817,
      "model/head/act_norm_min": 74.98200225830078,
      "model/head/act_over_embed": 72.84968397350137,
      "model/head/grad_frac": 0.11774624139070511,
      "model/head/grad_norm": 0.08697188645601273,
      "model/head/grad_zero_frac": 0.0001649813202675432,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.685523056402439,
      "model/head/update_ratio": 0.0014807963743805885,
      "model/head/weight_delta": 9.91331672668457,
      "model/head/weight_delta_rel": 0.17390893399715424,
      "model/head/weight_norm": 58.733184814453125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42278650403022766,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227360316685268,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226984977722168,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29050815867969493,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07632891833782196,
      "model/modality_embedder.encoders.pose/grad_norm": 0.056379467248916626,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5454334077380952,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001820503850467503,
      "model/modality_embedder.encoders.pose/weight_delta": 3.140035390853882,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10259474068880081,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96915626525879,
      "model/modality_embedder/grad_frac": 0.07632891833782196,
      "model/modality_embedder/grad_norm": 0.056379467248916626,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5454334077380952,
      "model/modality_embedder/update_ratio": 0.001820503850467503,
      "model/modality_embedder/weight_delta": 3.140035390853882,
      "model/modality_embedder/weight_delta_rel": 0.10259474068880081,
      "model/modality_embedder/weight_norm": 30.96915626525879,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.20247650146484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.283745281649246,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.30514907836914,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.000807743407112,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.061791107058525085,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.045641280710697174,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016328158089891076,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7038629055023193,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09853039681911469,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.952497482299805,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 80.37992858886719,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.089818041037553,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.847798347473145,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.55474849023083,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06660208851099014,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.049194857478141785,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016532139852643013,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.428316831588745,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11875957250595093,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.757102966308594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 81.65866088867188,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.78798877274487,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.186714172363281,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.721747315584974,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07676847279071808,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05670413747429848,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001845386577770114,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7118475437164307,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12463688850402832,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.72751235961914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.91948699951172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.682491289198605,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.107542991638184,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.02366718150398,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0739947110414505,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05465532839298248,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018252684967592359,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1876933574676514,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1089402288198471,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9437198638916,
      "model/normalizer/grad_frac": 0.2852531671524048,
      "model/normalizer/grad_norm": 0.2106989324092865,
      "model/normalizer/grad_zero_frac": 0.0002115311799570918,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0026792045682668686,
      "model/normalizer/weight_delta": 6.710230827331543,
      "model/normalizer/weight_delta_rel": 0.08642388880252838,
      "model/normalizer/weight_norm": 78.64234924316406,
      "pose_mae_dtheta": 0.2418811321258545,
      "pose_mae_dx": 0.05489087849855423,
      "pose_mae_dy": 0.03900200128555298,
      "pose_rmse_dtheta": 0.4166789650917053,
      "pose_rmse_dx": 0.13449233770370483,
      "pose_rmse_dy": 0.0866495668888092,
      "pose_rmse_mean": 0.21260695159435272,
      "rmse_dtheta": 0.04943994805216789,
      "rmse_dx": 0.01348700001835823,
      "rmse_dy": 0.007896038703620434,
      "rmse_mean": 0.023607661947607994,
      "rotation_flip": 0.01217656023800373,
      "sparse_tokens": 11102.0,
      "step": 9500,
      "turn_loss": 0.260136216878891,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.4414142352722542,
      "grad_norm": 1.0962636470794678,
      "learning_rate": 1.0534427387395391e-06,
      "loss": 0.1325,
      "mae_dtheta": 0.02309522032737732,
      "mae_dx": 0.004967904649674892,
      "mae_dy": 0.00493693258613348,
      "pose_mae_dtheta": 0.17404267191886902,
      "pose_mae_dx": 0.047352053225040436,
      "pose_mae_dy": 0.0407307930290699,
      "pose_rmse_dtheta": 0.3444090485572815,
      "pose_rmse_dx": 0.10773162543773651,
      "pose_rmse_dy": 0.0976378545165062,
      "pose_rmse_mean": 0.183259516954422,
      "rmse_dtheta": 0.041802432388067245,
      "rmse_dx": 0.012190696783363819,
      "rmse_dy": 0.010704085230827332,
      "rmse_mean": 0.021565739065408707,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 6585.0,
      "step": 9501,
      "turn_loss": 0.19022682309150696,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.441460695038097,
      "grad_norm": 0.6390042304992676,
      "learning_rate": 1.052631043421577e-06,
      "loss": 0.1174,
      "mae_dtheta": 0.02637418918311596,
      "mae_dx": 0.008559110574424267,
      "mae_dy": 0.004185570403933525,
      "pose_mae_dtheta": 0.19337475299835205,
      "pose_mae_dx": 0.07029052078723907,
      "pose_mae_dy": 0.06265708059072495,
      "pose_rmse_dtheta": 0.3445303440093994,
      "pose_rmse_dx": 0.19514140486717224,
      "pose_rmse_dy": 0.13705971837043762,
      "pose_rmse_mean": 0.22557716071605682,
      "rmse_dtheta": 0.04145065322518349,
      "rmse_dx": 0.021008990705013275,
      "rmse_dy": 0.007502083666622639,
      "rmse_mean": 0.023320576176047325,
      "rotation_flip": 0.019178081303834915,
      "sparse_tokens": 14694.0,
      "step": 9502,
      "turn_loss": 0.1930311769247055,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.44150715480393976,
      "grad_norm": 1.0562574863433838,
      "learning_rate": 1.0518196241452434e-06,
      "loss": 0.2884,
      "mae_dtheta": 0.02955699898302555,
      "mae_dx": 0.002808769466355443,
      "mae_dy": 0.0019045909866690636,
      "pose_mae_dtheta": 0.20305287837982178,
      "pose_mae_dx": 0.019593875855207443,
      "pose_mae_dy": 0.01671617478132248,
      "pose_rmse_dtheta": 0.4414573609828949,
      "pose_rmse_dx": 0.04659615829586983,
      "pose_rmse_dy": 0.04261072725057602,
      "pose_rmse_mean": 0.1768880933523178,
      "rmse_dtheta": 0.05295306071639061,
      "rmse_dx": 0.0068486882373690605,
      "rmse_dy": 0.004523097537457943,
      "rmse_mean": 0.021441616117954254,
      "rotation_flip": 0.013333333656191826,
      "sparse_tokens": 4813.0,
      "step": 9503,
      "turn_loss": 0.15027309954166412,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.4415536145697826,
      "grad_norm": 0.39740610122680664,
      "learning_rate": 1.0510084809672837e-06,
      "loss": 0.0934,
      "mae_dtheta": 0.03939363360404968,
      "mae_dx": 0.011203241534531116,
      "mae_dy": 0.0066522215493023396,
      "pose_mae_dtheta": 0.25370317697525024,
      "pose_mae_dx": 0.08833374828100204,
      "pose_mae_dy": 0.11108385026454926,
      "pose_rmse_dtheta": 0.4084514379501343,
      "pose_rmse_dx": 0.17496956884860992,
      "pose_rmse_dy": 0.24246537685394287,
      "pose_rmse_mean": 0.2752954661846161,
      "rmse_dtheta": 0.05485832691192627,
      "rmse_dx": 0.0235451627522707,
      "rmse_dy": 0.010875558480620384,
      "rmse_mean": 0.029759682714939117,
      "rotation_flip": 0.012232416309416294,
      "sparse_tokens": 5364.0,
      "step": 9504,
      "turn_loss": 0.2879994511604309,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.44160007433562537,
      "grad_norm": 0.4281858503818512,
      "learning_rate": 1.0501976139444191e-06,
      "loss": 0.1109,
      "mae_dtheta": 0.009856038726866245,
      "mae_dx": 0.001493635936640203,
      "mae_dy": 0.002263726433739066,
      "pose_mae_dtheta": 0.05725806578993797,
      "pose_mae_dx": 0.018841026350855827,
      "pose_mae_dy": 0.023502642288804054,
      "pose_rmse_dtheta": 0.1153426244854927,
      "pose_rmse_dx": 0.05215098336338997,
      "pose_rmse_dy": 0.050129011273384094,
      "pose_rmse_mean": 0.07254087924957275,
      "rmse_dtheta": 0.019234973937273026,
      "rmse_dx": 0.004278004169464111,
      "rmse_dy": 0.005038306582719088,
      "rmse_mean": 0.009517095051705837,
      "rotation_flip": 0.005941329523921013,
      "sparse_tokens": 32105.0,
      "step": 9505,
      "turn_loss": 0.07577598839998245,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.44164653410146815,
      "grad_norm": 0.8710096478462219,
      "learning_rate": 1.049387023133357e-06,
      "loss": 0.2696,
      "mae_dtheta": 0.026232412084937096,
      "mae_dx": 0.01326295267790556,
      "mae_dy": 0.005085851531475782,
      "pose_mae_dtheta": 0.18718457221984863,
      "pose_mae_dx": 0.10694979131221771,
      "pose_mae_dy": 0.08108992874622345,
      "pose_rmse_dtheta": 0.3561244308948517,
      "pose_rmse_dx": 0.24595069885253906,
      "pose_rmse_dy": 0.16567623615264893,
      "pose_rmse_mean": 0.25591713190078735,
      "rmse_dtheta": 0.040876034647226334,
      "rmse_dx": 0.027399983257055283,
      "rmse_dy": 0.00796101987361908,
      "rmse_mean": 0.02541234716773033,
      "rotation_flip": 0.005964214913547039,
      "sparse_tokens": 9137.0,
      "step": 9506,
      "turn_loss": 0.22539663314819336,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.4416929938673109,
      "grad_norm": 0.5903414487838745,
      "learning_rate": 1.0485767085907788e-06,
      "loss": 0.0759,
      "mae_dtheta": 0.024077165871858597,
      "mae_dx": 0.018878111615777016,
      "mae_dy": 0.004626294132322073,
      "pose_mae_dtheta": 0.14409056305885315,
      "pose_mae_dx": 0.12159471213817596,
      "pose_mae_dy": 0.06383921951055527,
      "pose_rmse_dtheta": 0.2021419107913971,
      "pose_rmse_dx": 0.1980476677417755,
      "pose_rmse_dy": 0.13862931728363037,
      "pose_rmse_mean": 0.17960630357265472,
      "rmse_dtheta": 0.03589672967791557,
      "rmse_dx": 0.031011927872896194,
      "rmse_dy": 0.008075893856585026,
      "rmse_mean": 0.024994850158691406,
      "rotation_flip": 0.004830917809158564,
      "sparse_tokens": 3922.0,
      "step": 9507,
      "turn_loss": 0.25981104373931885,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4417394536331537,
      "grad_norm": 0.3634275496006012,
      "learning_rate": 1.047766670373354e-06,
      "loss": 0.097,
      "mae_dtheta": 0.008807736448943615,
      "mae_dx": 0.0011232474353164434,
      "mae_dy": 0.002179449424147606,
      "pose_mae_dtheta": 0.05339888855814934,
      "pose_mae_dx": 0.016554370522499084,
      "pose_mae_dy": 0.023626450449228287,
      "pose_rmse_dtheta": 0.13678933680057526,
      "pose_rmse_dx": 0.037243906408548355,
      "pose_rmse_dy": 0.04814258590340614,
      "pose_rmse_mean": 0.07405860722064972,
      "rmse_dtheta": 0.019028915092349052,
      "rmse_dx": 0.003023519180715084,
      "rmse_dy": 0.004183841869235039,
      "rmse_mean": 0.008745425380766392,
      "rotation_flip": 0.006028131116181612,
      "sparse_tokens": 32121.0,
      "step": 9508,
      "turn_loss": 0.07596107572317123,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.4417859133989965,
      "grad_norm": 0.6126497387886047,
      "learning_rate": 1.0469569085377262e-06,
      "loss": 0.1148,
      "mae_dtheta": 0.04418051987886429,
      "mae_dx": 0.01296919770538807,
      "mae_dy": 0.005953967105597258,
      "pose_mae_dtheta": 0.36077386140823364,
      "pose_mae_dx": 0.09764989465475082,
      "pose_mae_dy": 0.07697384059429169,
      "pose_rmse_dtheta": 0.6035688519477844,
      "pose_rmse_dx": 0.22080819308757782,
      "pose_rmse_dy": 0.2002871036529541,
      "pose_rmse_mean": 0.3415547311306,
      "rmse_dtheta": 0.06371654570102692,
      "rmse_dx": 0.025453506037592888,
      "rmse_dy": 0.012535734102129936,
      "rmse_mean": 0.03390192985534668,
      "rotation_flip": 0.009656652808189392,
      "sparse_tokens": 14384.0,
      "step": 9509,
      "turn_loss": 0.3289628326892853,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.44183237316483925,
      "grad_norm": 0.37862077355384827,
      "learning_rate": 1.0461474231405245e-06,
      "loss": 0.0975,
      "mae_dtheta": 0.041271552443504333,
      "mae_dx": 0.010623040609061718,
      "mae_dy": 0.009298008866608143,
      "pose_mae_dtheta": 0.2696336805820465,
      "pose_mae_dx": 0.04305834695696831,
      "pose_mae_dy": 0.08109664916992188,
      "pose_rmse_dtheta": 0.45552071928977966,
      "pose_rmse_dx": 0.0945582464337349,
      "pose_rmse_dy": 0.26487353444099426,
      "pose_rmse_mean": 0.27165085077285767,
      "rmse_dtheta": 0.05999519303441048,
      "rmse_dx": 0.02090679295361042,
      "rmse_dy": 0.019576534628868103,
      "rmse_mean": 0.03349284082651138,
      "rotation_flip": 0.015706805512309074,
      "sparse_tokens": 2839.0,
      "step": 9510,
      "turn_loss": 0.34845295548439026,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.44187883293068203,
      "grad_norm": 0.3944046199321747,
      "learning_rate": 1.0453382142383545e-06,
      "loss": 0.0937,
      "mae_dtheta": 0.013209028169512749,
      "mae_dx": 0.0025099797639995813,
      "mae_dy": 0.003622881369665265,
      "pose_mae_dtheta": 0.08647612482309341,
      "pose_mae_dx": 0.027911029756069183,
      "pose_mae_dy": 0.030859487131237984,
      "pose_rmse_dtheta": 0.2251197099685669,
      "pose_rmse_dx": 0.07460948824882507,
      "pose_rmse_dy": 0.0695369765162468,
      "pose_rmse_mean": 0.12308873236179352,
      "rmse_dtheta": 0.027325952425599098,
      "rmse_dx": 0.0069374511949718,
      "rmse_dy": 0.008832073770463467,
      "rmse_mean": 0.014365158975124359,
      "rotation_flip": 0.0042105261236429214,
      "sparse_tokens": 32121.0,
      "step": 9511,
      "turn_loss": 0.1294015347957611,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.4419252926965248,
      "grad_norm": 0.4782218635082245,
      "learning_rate": 1.0445292818878071e-06,
      "loss": 0.085,
      "mae_dtheta": 0.023215293884277344,
      "mae_dx": 0.009438990615308285,
      "mae_dy": 0.003834582632407546,
      "pose_mae_dtheta": 0.1643611639738083,
      "pose_mae_dx": 0.07598716765642166,
      "pose_mae_dy": 0.04027308523654938,
      "pose_rmse_dtheta": 0.33040571212768555,
      "pose_rmse_dx": 0.17715731263160706,
      "pose_rmse_dy": 0.10242556035518646,
      "pose_rmse_mean": 0.20332953333854675,
      "rmse_dtheta": 0.04005349799990654,
      "rmse_dx": 0.02078401856124401,
      "rmse_dy": 0.007859616540372372,
      "rmse_mean": 0.022899044677615166,
      "rotation_flip": 0.01536312885582447,
      "sparse_tokens": 12460.0,
      "step": 9512,
      "turn_loss": 0.16140341758728027,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4419717524623676,
      "grad_norm": 0.32449862360954285,
      "learning_rate": 1.0437206261454486e-06,
      "loss": 0.0879,
      "mae_dtheta": 0.008484677411615849,
      "mae_dx": 0.001467452384531498,
      "mae_dy": 0.0016396981664001942,
      "pose_mae_dtheta": 0.05018267408013344,
      "pose_mae_dx": 0.018438808619976044,
      "pose_mae_dy": 0.018682755529880524,
      "pose_rmse_dtheta": 0.12662716209888458,
      "pose_rmse_dx": 0.051834587007761,
      "pose_rmse_dy": 0.040850862860679626,
      "pose_rmse_mean": 0.07310420274734497,
      "rmse_dtheta": 0.018660645931959152,
      "rmse_dx": 0.004468555562198162,
      "rmse_dy": 0.003940879832953215,
      "rmse_mean": 0.009023360908031464,
      "rotation_flip": 0.0073370737954974174,
      "sparse_tokens": 32089.0,
      "step": 9513,
      "turn_loss": 0.0699397474527359,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.44201821222821036,
      "grad_norm": 0.45876622200012207,
      "learning_rate": 1.0429122470678315e-06,
      "loss": 0.1261,
      "mae_dtheta": 0.009902005083858967,
      "mae_dx": 0.0012597469612956047,
      "mae_dy": 0.0019984699320048094,
      "pose_mae_dtheta": 0.06394550204277039,
      "pose_mae_dx": 0.01909627392888069,
      "pose_mae_dy": 0.026499558240175247,
      "pose_rmse_dtheta": 0.1539636254310608,
      "pose_rmse_dx": 0.050832685083150864,
      "pose_rmse_dy": 0.06272713840007782,
      "pose_rmse_mean": 0.08917449414730072,
      "rmse_dtheta": 0.02077656053006649,
      "rmse_dx": 0.003929879050701857,
      "rmse_dy": 0.004171509295701981,
      "rmse_mean": 0.00962598342448473,
      "rotation_flip": 0.004557538777589798,
      "sparse_tokens": 32089.0,
      "step": 9514,
      "turn_loss": 0.0698489397764206,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.44206467199405314,
      "grad_norm": 0.4677809774875641,
      "learning_rate": 1.042104144711484e-06,
      "loss": 0.0916,
      "mae_dtheta": 0.03171291574835777,
      "mae_dx": 0.006286329124122858,
      "mae_dy": 0.0054175774566829205,
      "pose_mae_dtheta": 0.21873819828033447,
      "pose_mae_dx": 0.05435335636138916,
      "pose_mae_dy": 0.06554671376943588,
      "pose_rmse_dtheta": 0.37643155455589294,
      "pose_rmse_dx": 0.11141128838062286,
      "pose_rmse_dy": 0.14153540134429932,
      "pose_rmse_mean": 0.20979276299476624,
      "rmse_dtheta": 0.04891306534409523,
      "rmse_dx": 0.01542376447468996,
      "rmse_dy": 0.01017504557967186,
      "rmse_mean": 0.02483729086816311,
      "rotation_flip": 0.01576576568186283,
      "sparse_tokens": 14942.0,
      "step": 9515,
      "turn_loss": 0.2154039442539215,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4421111317598959,
      "grad_norm": 0.42046067118644714,
      "learning_rate": 1.0412963191329172e-06,
      "loss": 0.0697,
      "mae_dtheta": 0.006907691713422537,
      "mae_dx": 0.002256714040413499,
      "mae_dy": 0.0008705154759809375,
      "pose_mae_dtheta": 0.0536770224571228,
      "pose_mae_dx": 0.021494589745998383,
      "pose_mae_dy": 0.014882896095514297,
      "pose_rmse_dtheta": 0.15085777640342712,
      "pose_rmse_dx": 0.06941796094179153,
      "pose_rmse_dy": 0.04336383193731308,
      "pose_rmse_mean": 0.08787985891103745,
      "rmse_dtheta": 0.018925439566373825,
      "rmse_dx": 0.00763865327462554,
      "rmse_dy": 0.0021278425119817257,
      "rmse_mean": 0.009563978761434555,
      "rotation_flip": 0.0028818442951887846,
      "sparse_tokens": 32105.0,
      "step": 9516,
      "turn_loss": 0.052929963916540146,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4421575915257387,
      "grad_norm": 0.6004297733306885,
      "learning_rate": 1.0404887703886252e-06,
      "loss": 0.1388,
      "mae_dtheta": 0.012627365998923779,
      "mae_dx": 0.002732940949499607,
      "mae_dy": 0.004705104045569897,
      "pose_mae_dtheta": 0.08309412747621536,
      "pose_mae_dx": 0.030439285561442375,
      "pose_mae_dy": 0.034180354326963425,
      "pose_rmse_dtheta": 0.20043247938156128,
      "pose_rmse_dx": 0.07116422802209854,
      "pose_rmse_dy": 0.06609583646059036,
      "pose_rmse_mean": 0.11256417632102966,
      "rmse_dtheta": 0.024951927363872528,
      "rmse_dx": 0.006597525905817747,
      "rmse_dy": 0.0097734984010458,
      "rmse_mean": 0.013774318620562553,
      "rotation_flip": 0.0058746738359332085,
      "sparse_tokens": 32105.0,
      "step": 9517,
      "turn_loss": 0.14050261676311493,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.44220405129158147,
      "grad_norm": 0.46919023990631104,
      "learning_rate": 1.039681498535078e-06,
      "loss": 0.1096,
      "mae_dtheta": 0.03876734897494316,
      "mae_dx": 0.012072895653545856,
      "mae_dy": 0.0039766146801412106,
      "pose_mae_dtheta": 0.28601086139678955,
      "pose_mae_dx": 0.1185234785079956,
      "pose_mae_dy": 0.042237184941768646,
      "pose_rmse_dtheta": 0.4781460165977478,
      "pose_rmse_dx": 0.21081998944282532,
      "pose_rmse_dy": 0.07746075093746185,
      "pose_rmse_mean": 0.25547561049461365,
      "rmse_dtheta": 0.05727057158946991,
      "rmse_dx": 0.0228193998336792,
      "rmse_dy": 0.007835270836949348,
      "rmse_mean": 0.029308414086699486,
      "rotation_flip": 0.019370460882782936,
      "sparse_tokens": 6907.0,
      "step": 9518,
      "turn_loss": 0.2666080594062805,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.44225051105742424,
      "grad_norm": 0.5301486849784851,
      "learning_rate": 1.0388745036287295e-06,
      "loss": 0.1073,
      "mae_dtheta": 0.0076433951035141945,
      "mae_dx": 0.001552467467263341,
      "mae_dy": 0.0016912963474169374,
      "pose_mae_dtheta": 0.04572201892733574,
      "pose_mae_dx": 0.0154871866106987,
      "pose_mae_dy": 0.018489249050617218,
      "pose_rmse_dtheta": 0.10061474144458771,
      "pose_rmse_dx": 0.037518735975027084,
      "pose_rmse_dy": 0.04363589361310005,
      "pose_rmse_mean": 0.06058979034423828,
      "rmse_dtheta": 0.015986638143658638,
      "rmse_dx": 0.004480921197682619,
      "rmse_dy": 0.0035795001313090324,
      "rmse_mean": 0.008015686646103859,
      "rotation_flip": 0.0010416667209938169,
      "sparse_tokens": 32201.0,
      "step": 9519,
      "turn_loss": 0.07013403624296188,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.4422969708232671,
      "grad_norm": 0.49966612458229065,
      "learning_rate": 1.0380677857260125e-06,
      "loss": 0.0869,
      "mae_dtheta": 0.010412946343421936,
      "mae_dx": 0.00457356171682477,
      "mae_dy": 0.0028493001591414213,
      "pose_mae_dtheta": 0.08067122846841812,
      "pose_mae_dx": 0.045827217400074005,
      "pose_mae_dy": 0.03159261867403984,
      "pose_rmse_dtheta": 0.1816318929195404,
      "pose_rmse_dx": 0.14068260788917542,
      "pose_rmse_dy": 0.0828702375292778,
      "pose_rmse_mean": 0.1350615918636322,
      "rmse_dtheta": 0.021823078393936157,
      "rmse_dx": 0.013556300662457943,
      "rmse_dy": 0.007676639128476381,
      "rmse_mean": 0.01435200683772564,
      "rotation_flip": 0.008739076554775238,
      "sparse_tokens": 32025.0,
      "step": 9520,
      "turn_loss": 0.1069595068693161,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.44234343058910985,
      "grad_norm": 0.5424321293830872,
      "learning_rate": 1.0372613448833429e-06,
      "loss": 0.1135,
      "mae_dtheta": 0.009013385511934757,
      "mae_dx": 0.00179377687163651,
      "mae_dy": 0.0021348902955651283,
      "pose_mae_dtheta": 0.05943223834037781,
      "pose_mae_dx": 0.018514690920710564,
      "pose_mae_dy": 0.022655420005321503,
      "pose_rmse_dtheta": 0.15596622228622437,
      "pose_rmse_dx": 0.05183274671435356,
      "pose_rmse_dy": 0.05976170301437378,
      "pose_rmse_mean": 0.089186891913414,
      "rmse_dtheta": 0.022024614736437798,
      "rmse_dx": 0.005574217066168785,
      "rmse_dy": 0.0058067431673407555,
      "rmse_mean": 0.011135192587971687,
      "rotation_flip": 0.0036555645056068897,
      "sparse_tokens": 32121.0,
      "step": 9521,
      "turn_loss": 0.0836847573518753,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.44238989035495263,
      "grad_norm": 0.6474024057388306,
      "learning_rate": 1.0364551811571126e-06,
      "loss": 0.1111,
      "mae_dtheta": 0.00623840419575572,
      "mae_dx": 0.0011177004780620337,
      "mae_dy": 0.0007372910040430725,
      "pose_mae_dtheta": 0.04199600964784622,
      "pose_mae_dx": 0.009230230003595352,
      "pose_mae_dy": 0.010205866768956184,
      "pose_rmse_dtheta": 0.14962603151798248,
      "pose_rmse_dx": 0.023597760125994682,
      "pose_rmse_dy": 0.02800530195236206,
      "pose_rmse_mean": 0.06707637012004852,
      "rmse_dtheta": 0.02041514217853546,
      "rmse_dx": 0.003471957053989172,
      "rmse_dy": 0.0017170660430565476,
      "rmse_mean": 0.008534722030162811,
      "rotation_flip": 0.004622496198862791,
      "sparse_tokens": 32169.0,
      "step": 9522,
      "turn_loss": 0.03735187277197838,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.4424363501207954,
      "grad_norm": 0.4092124104499817,
      "learning_rate": 1.0356492946036994e-06,
      "loss": 0.0949,
      "mae_dtheta": 0.03148956224322319,
      "mae_dx": 0.009451455436646938,
      "mae_dy": 0.006381141487509012,
      "pose_mae_dtheta": 0.2511133551597595,
      "pose_mae_dx": 0.08651559799909592,
      "pose_mae_dy": 0.08464641869068146,
      "pose_rmse_dtheta": 0.4141855537891388,
      "pose_rmse_dx": 0.1867392659187317,
      "pose_rmse_dy": 0.18786723911762238,
      "pose_rmse_mean": 0.262930691242218,
      "rmse_dtheta": 0.046556271612644196,
      "rmse_dx": 0.021170703694224358,
      "rmse_dy": 0.011378663592040539,
      "rmse_mean": 0.02636854723095894,
      "rotation_flip": 0.020069807767868042,
      "sparse_tokens": 18527.0,
      "step": 9523,
      "turn_loss": 0.2651332914829254,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 34606.0,
      "epoch": 0.4424828098866382,
      "grad_norm": 0.5706712603569031,
      "learning_rate": 1.0348436852794597e-06,
      "loss": 0.1299,
      "mae_dtheta": 0.03661474958062172,
      "mae_dx": 0.014525670558214188,
      "mae_dy": 0.005413474049419165,
      "pose_mae_dtheta": 0.2934499979019165,
      "pose_mae_dx": 0.10878303647041321,
      "pose_mae_dy": 0.07756753265857697,
      "pose_rmse_dtheta": 0.48220354318618774,
      "pose_rmse_dx": 0.24597413837909698,
      "pose_rmse_dy": 0.17740556597709656,
      "pose_rmse_mean": 0.30186110734939575,
      "rmse_dtheta": 0.05369893088936806,
      "rmse_dx": 0.028066372498869896,
      "rmse_dy": 0.010119008831679821,
      "rmse_mean": 0.030628103762865067,
      "rotation_flip": 0.016949152573943138,
      "sparse_tokens": 25617.0,
      "step": 9524,
      "turn_loss": 0.30873650312423706,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.44252926965248096,
      "grad_norm": 0.4492358863353729,
      "learning_rate": 1.0340383532407283e-06,
      "loss": 0.1099,
      "mae_dtheta": 0.030894162133336067,
      "mae_dx": 0.009398087859153748,
      "mae_dy": 0.003745271824300289,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4492359459400177,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.04701232910156,
      "model/head/act_norm_mean": 103.91106404049296,
      "model/head/act_norm_min": 64.99567413330078,
      "model/head/act_over_embed": 71.40865603933551,
      "model/head/grad_frac": 0.10817950963973999,
      "model/head/grad_norm": 0.04859812557697296,
      "model/head/grad_zero_frac": 0.00018021036521531641,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6928917253521126,
      "model/head/update_ratio": 0.0008274319116026163,
      "model/head/weight_delta": 9.915792465209961,
      "model/head/weight_delta_rel": 0.1739523708820343,
      "model/head/weight_norm": 58.73368453979492,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228077530860901,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42273751894632977,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226760268211365,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29050918075092524,
      "model/modality_embedder.encoders.pose/grad_frac": 0.117642343044281,
      "model/modality_embedder.encoders.pose/grad_norm": 0.052849169820547104,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5454372829861112,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017065040301531553,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1400158405303955,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10259410738945007,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969261169433594,
      "model/modality_embedder/grad_frac": 0.117642343044281,
      "model/modality_embedder/grad_norm": 0.052849169820547104,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5454372829861112,
      "model/modality_embedder/update_ratio": 0.0017065040301531553,
      "model/modality_embedder/weight_delta": 3.1400158405303955,
      "model/modality_embedder/weight_delta_rel": 0.10259410738945007,
      "model/modality_embedder/weight_norm": 30.969261169433594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.40946960449219,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.080998141627543,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.273642539978027,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.861478010635567,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07966431230306625,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.035788074135780334,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012803087010979652,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7049970626831055,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09857172518968582,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95269203186035,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.82835388183594,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.887998127654818,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.855812072753906,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.416055956286414,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07984999567270279,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.035871487110853195,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012054622638970613,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4298717975616455,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11881344020366669,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.7574520111084,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.65143585205078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.498779133132125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.009791374206543,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.52299974361979,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07631199806928635,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03428209200501442,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011156705440953374,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.713378667831421,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12468830496072769,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.727792739868164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.85912322998047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.340427984574113,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.794798851013184,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.78859807611892,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08598516881465912,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03862762823700905,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012899937573820353,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1891050338745117,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10898847877979279,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.944042205810547,
      "model/normalizer/grad_frac": 0.3255809247493744,
      "model/normalizer/grad_norm": 0.14626266062259674,
      "model/normalizer/grad_zero_frac": 0.0001997137878788635,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018598362803459167,
      "model/normalizer/weight_delta": 6.713166236877441,
      "model/normalizer/weight_delta_rel": 0.08646169304847717,
      "model/normalizer/weight_norm": 78.64276123046875,
      "pose_mae_dtheta": 0.24437235295772552,
      "pose_mae_dx": 0.07088269293308258,
      "pose_mae_dy": 0.043848469853401184,
      "pose_rmse_dtheta": 0.4123113453388214,
      "pose_rmse_dx": 0.1724260002374649,
      "pose_rmse_dy": 0.10874402523040771,
      "pose_rmse_mean": 0.2311604619026184,
      "rmse_dtheta": 0.046951089054346085,
      "rmse_dx": 0.02101820707321167,
      "rmse_dy": 0.008245391771197319,
      "rmse_mean": 0.025404896587133408,
      "rotation_flip": 0.017421603202819824,
      "sparse_tokens": 17442.0,
      "step": 9525,
      "turn_loss": 0.23781117796897888,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 34713.0,
      "epoch": 0.44257572941832374,
      "grad_norm": 0.9163326025009155,
      "learning_rate": 1.0332332985438248e-06,
      "loss": 0.286,
      "mae_dtheta": 0.039153870195150375,
      "mae_dx": 0.011432086117565632,
      "mae_dy": 0.005206858739256859,
      "pose_mae_dtheta": 0.28741708397865295,
      "pose_mae_dx": 0.09114055335521698,
      "pose_mae_dy": 0.04829421266913414,
      "pose_rmse_dtheta": 0.49627774953842163,
      "pose_rmse_dx": 0.20235078036785126,
      "pose_rmse_dy": 0.15280692279338837,
      "pose_rmse_mean": 0.2838118374347687,
      "rmse_dtheta": 0.05746529996395111,
      "rmse_dx": 0.02297963574528694,
      "rmse_dy": 0.01284095924347639,
      "rmse_mean": 0.031095296144485474,
      "rotation_flip": 0.013582343235611916,
      "sparse_tokens": 28953.0,
      "step": 9526,
      "turn_loss": 0.31762436032295227,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4426221891841665,
      "grad_norm": 0.3838370740413666,
      "learning_rate": 1.0324285212450446e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.006152837537229061,
      "mae_dx": 0.001055475790053606,
      "mae_dy": 0.0016009857645258307,
      "pose_mae_dtheta": 0.037738800048828125,
      "pose_mae_dx": 0.012940643355250359,
      "pose_mae_dy": 0.016960930079221725,
      "pose_rmse_dtheta": 0.08704261481761932,
      "pose_rmse_dx": 0.03002840280532837,
      "pose_rmse_dy": 0.040151022374629974,
      "pose_rmse_mean": 0.05240734666585922,
      "rmse_dtheta": 0.014713112264871597,
      "rmse_dx": 0.0029377033933997154,
      "rmse_dy": 0.003706184681504965,
      "rmse_mean": 0.007119000889360905,
      "rotation_flip": 0.0018201674101874232,
      "sparse_tokens": 32169.0,
      "step": 9527,
      "turn_loss": 0.055326443165540695,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4426686489500093,
      "grad_norm": 0.4099527895450592,
      "learning_rate": 1.031624021400669e-06,
      "loss": 0.0684,
      "mae_dtheta": 0.0046165576204657555,
      "mae_dx": 0.0010680754203349352,
      "mae_dy": 0.0006552950362674892,
      "pose_mae_dtheta": 0.029588043689727783,
      "pose_mae_dx": 0.008920450694859028,
      "pose_mae_dy": 0.008614419028162956,
      "pose_rmse_dtheta": 0.11904525011777878,
      "pose_rmse_dx": 0.025346992537379265,
      "pose_rmse_dy": 0.026897454634308815,
      "pose_rmse_mean": 0.05709656700491905,
      "rmse_dtheta": 0.016498565673828125,
      "rmse_dx": 0.003935583867132664,
      "rmse_dy": 0.0016922459471970797,
      "rmse_mean": 0.007375465240329504,
      "rotation_flip": 0.0032590983901172876,
      "sparse_tokens": 32169.0,
      "step": 9528,
      "turn_loss": 0.03347555175423622,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.44271510871585207,
      "grad_norm": 0.5097500681877136,
      "learning_rate": 1.0308197990669538e-06,
      "loss": 0.1223,
      "mae_dtheta": 0.005159929394721985,
      "mae_dx": 0.0008802381344139576,
      "mae_dy": 0.00044250403880141675,
      "pose_mae_dtheta": 0.03469682112336159,
      "pose_mae_dx": 0.00721997395157814,
      "pose_mae_dy": 0.006174590438604355,
      "pose_rmse_dtheta": 0.16629241406917572,
      "pose_rmse_dx": 0.016953369602560997,
      "pose_rmse_dy": 0.018818024545907974,
      "pose_rmse_mean": 0.06735460460186005,
      "rmse_dtheta": 0.020987994968891144,
      "rmse_dx": 0.0027184258215129375,
      "rmse_dy": 0.0010723521700128913,
      "rmse_mean": 0.008259591646492481,
      "rotation_flip": 0.002733734203502536,
      "sparse_tokens": 32169.0,
      "step": 9529,
      "turn_loss": 0.03377564251422882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.44276156848169484,
      "grad_norm": 0.3924306333065033,
      "learning_rate": 1.0300158543001404e-06,
      "loss": 0.0818,
      "mae_dtheta": 0.005142490845173597,
      "mae_dx": 0.0010158540681004524,
      "mae_dy": 0.0011456599459052086,
      "pose_mae_dtheta": 0.036569442600011826,
      "pose_mae_dx": 0.011239980347454548,
      "pose_mae_dy": 0.013009312562644482,
      "pose_rmse_dtheta": 0.13170960545539856,
      "pose_rmse_dx": 0.03780260309576988,
      "pose_rmse_dy": 0.03441635146737099,
      "pose_rmse_mean": 0.06797619163990021,
      "rmse_dtheta": 0.01602180115878582,
      "rmse_dx": 0.0037387004122138023,
      "rmse_dy": 0.003008152823895216,
      "rmse_mean": 0.007589551620185375,
      "rotation_flip": 0.0,
      "sparse_tokens": 32057.0,
      "step": 9530,
      "turn_loss": 0.04428752884268761,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.4428080282475376,
      "grad_norm": 0.9113226532936096,
      "learning_rate": 1.0292121871564509e-06,
      "loss": 0.2146,
      "mae_dtheta": 0.031804222613573074,
      "mae_dx": 0.012067360803484917,
      "mae_dy": 0.006877850275486708,
      "pose_mae_dtheta": 0.23929840326309204,
      "pose_mae_dx": 0.07625487446784973,
      "pose_mae_dy": 0.06004105880856514,
      "pose_rmse_dtheta": 0.472117155790329,
      "pose_rmse_dx": 0.1871737241744995,
      "pose_rmse_dy": 0.12830568850040436,
      "pose_rmse_mean": 0.26253220438957214,
      "rmse_dtheta": 0.05165985971689224,
      "rmse_dx": 0.027098556980490685,
      "rmse_dy": 0.01576978527009487,
      "rmse_mean": 0.0315094031393528,
      "rotation_flip": 0.007843137718737125,
      "sparse_tokens": 9592.0,
      "step": 9531,
      "turn_loss": 0.3383901119232178,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.4428544880133804,
      "grad_norm": 0.6727945804595947,
      "learning_rate": 1.0284087976920825e-06,
      "loss": 0.1518,
      "mae_dtheta": 0.02546463906764984,
      "mae_dx": 0.005376330576837063,
      "mae_dy": 0.004652655217796564,
      "pose_mae_dtheta": 0.15884430706501007,
      "pose_mae_dx": 0.04506559297442436,
      "pose_mae_dy": 0.06526091694831848,
      "pose_rmse_dtheta": 0.30852198600769043,
      "pose_rmse_dx": 0.11838709563016891,
      "pose_rmse_dy": 0.13804441690444946,
      "pose_rmse_mean": 0.18831783533096313,
      "rmse_dtheta": 0.04346860572695732,
      "rmse_dx": 0.015601564198732376,
      "rmse_dy": 0.009631818160414696,
      "rmse_mean": 0.022900663316249847,
      "rotation_flip": 0.018932875245809555,
      "sparse_tokens": 10650.0,
      "step": 9532,
      "turn_loss": 0.16322116553783417,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.4429009477792232,
      "grad_norm": 0.6322160959243774,
      "learning_rate": 1.02760568596322e-06,
      "loss": 0.1424,
      "mae_dtheta": 0.02584862895309925,
      "mae_dx": 0.007935815490782261,
      "mae_dy": 0.004182008095085621,
      "pose_mae_dtheta": 0.19108927249908447,
      "pose_mae_dx": 0.06642907857894897,
      "pose_mae_dy": 0.05188354477286339,
      "pose_rmse_dtheta": 0.380931556224823,
      "pose_rmse_dx": 0.1758246272802353,
      "pose_rmse_dy": 0.12995202839374542,
      "pose_rmse_mean": 0.22890274226665497,
      "rmse_dtheta": 0.04428446665406227,
      "rmse_dx": 0.01941845566034317,
      "rmse_dy": 0.008572109043598175,
      "rmse_mean": 0.024091679602861404,
      "rotation_flip": 0.007776049897074699,
      "sparse_tokens": 11899.0,
      "step": 9533,
      "turn_loss": 0.22169166803359985,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.44294740754506595,
      "grad_norm": 0.3401530981063843,
      "learning_rate": 1.0268028520260232e-06,
      "loss": 0.0744,
      "mae_dtheta": 0.021681005135178566,
      "mae_dx": 0.0065761227160692215,
      "mae_dy": 0.007584044709801674,
      "pose_mae_dtheta": 0.1424228847026825,
      "pose_mae_dx": 0.056749869138002396,
      "pose_mae_dy": 0.08658592402935028,
      "pose_rmse_dtheta": 0.2638576328754425,
      "pose_rmse_dx": 0.1362857222557068,
      "pose_rmse_dy": 0.17656780779361725,
      "pose_rmse_mean": 0.19223706424236298,
      "rmse_dtheta": 0.03796930983662605,
      "rmse_dx": 0.015548419207334518,
      "rmse_dy": 0.012840216979384422,
      "rmse_mean": 0.022119317203760147,
      "rotation_flip": 0.0038314175326377153,
      "sparse_tokens": 5310.0,
      "step": 9534,
      "turn_loss": 0.1796436458826065,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.44299386731090873,
      "grad_norm": 0.6570305228233337,
      "learning_rate": 1.026000295936635e-06,
      "loss": 0.1464,
      "mae_dtheta": 0.030130017548799515,
      "mae_dx": 0.012287053279578686,
      "mae_dy": 0.004647089168429375,
      "pose_mae_dtheta": 0.21874268352985382,
      "pose_mae_dx": 0.08724760264158249,
      "pose_mae_dy": 0.046727798879146576,
      "pose_rmse_dtheta": 0.4056106209754944,
      "pose_rmse_dx": 0.19555097818374634,
      "pose_rmse_dy": 0.1272948980331421,
      "pose_rmse_mean": 0.24281883239746094,
      "rmse_dtheta": 0.04703877493739128,
      "rmse_dx": 0.02395091950893402,
      "rmse_dy": 0.010724103078246117,
      "rmse_mean": 0.02723793499171734,
      "rotation_flip": 0.010787486098706722,
      "sparse_tokens": 16436.0,
      "step": 9535,
      "turn_loss": 0.2423606961965561,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4430403270767515,
      "grad_norm": 0.3804318606853485,
      "learning_rate": 1.0251980177511806e-06,
      "loss": 0.0891,
      "mae_dtheta": 0.008622991852462292,
      "mae_dx": 0.0012884209863841534,
      "mae_dy": 0.0015044594183564186,
      "pose_mae_dtheta": 0.05317297205328941,
      "pose_mae_dx": 0.01635437086224556,
      "pose_mae_dy": 0.01814824342727661,
      "pose_rmse_dtheta": 0.15598399937152863,
      "pose_rmse_dx": 0.04316713288426399,
      "pose_rmse_dy": 0.04839306324720383,
      "pose_rmse_mean": 0.08251473307609558,
      "rmse_dtheta": 0.023376302793622017,
      "rmse_dx": 0.0037584095261991024,
      "rmse_dy": 0.003648356767371297,
      "rmse_mean": 0.010261023417115211,
      "rotation_flip": 0.002977667609229684,
      "sparse_tokens": 32105.0,
      "step": 9536,
      "turn_loss": 0.058274995535612106,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.44308678684259434,
      "grad_norm": 0.40879741311073303,
      "learning_rate": 1.0243960175257605e-06,
      "loss": 0.1039,
      "mae_dtheta": 0.03108930215239525,
      "mae_dx": 0.013428647071123123,
      "mae_dy": 0.004668685141950846,
      "pose_mae_dtheta": 0.2606133222579956,
      "pose_mae_dx": 0.09181467443704605,
      "pose_mae_dy": 0.07243695855140686,
      "pose_rmse_dtheta": 0.49174126982688904,
      "pose_rmse_dx": 0.18195372819900513,
      "pose_rmse_dy": 0.18099676072597504,
      "pose_rmse_mean": 0.2848972678184509,
      "rmse_dtheta": 0.05115879699587822,
      "rmse_dx": 0.024797262623906136,
      "rmse_dy": 0.009382931515574455,
      "rmse_mean": 0.02844633162021637,
      "rotation_flip": 0.0041841003112494946,
      "sparse_tokens": 8990.0,
      "step": 9537,
      "turn_loss": 0.22054965794086456,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.4431332466084371,
      "grad_norm": 2.4308831691741943,
      "learning_rate": 1.023594295316463e-06,
      "loss": 0.2524,
      "mae_dtheta": 0.02247125841677189,
      "mae_dx": 0.0032808224204927683,
      "mae_dy": 0.0018348576268181205,
      "pose_mae_dtheta": 0.1931372582912445,
      "pose_mae_dx": 0.03155701234936714,
      "pose_mae_dy": 0.016720036044716835,
      "pose_rmse_dtheta": 0.49473220109939575,
      "pose_rmse_dx": 0.08274959027767181,
      "pose_rmse_dy": 0.053164586424827576,
      "pose_rmse_mean": 0.2102154791355133,
      "rmse_dtheta": 0.050026386976242065,
      "rmse_dx": 0.011180932633578777,
      "rmse_dy": 0.005172898061573505,
      "rmse_mean": 0.022126739844679832,
      "rotation_flip": 0.005050505045801401,
      "sparse_tokens": 3857.0,
      "step": 9538,
      "turn_loss": 0.08737201243638992,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4431797063742799,
      "grad_norm": 0.5709970593452454,
      "learning_rate": 1.0227928511793484e-06,
      "loss": 0.0856,
      "mae_dtheta": 0.006025950890034437,
      "mae_dx": 0.0009310339228250086,
      "mae_dy": 0.0010849869577214122,
      "pose_mae_dtheta": 0.041936635971069336,
      "pose_mae_dx": 0.01267891563475132,
      "pose_mae_dy": 0.016777096316218376,
      "pose_rmse_dtheta": 0.10962888598442078,
      "pose_rmse_dx": 0.035453103482723236,
      "pose_rmse_dy": 0.04279021546244621,
      "pose_rmse_mean": 0.06262407451868057,
      "rmse_dtheta": 0.015397196635603905,
      "rmse_dx": 0.0033861289266496897,
      "rmse_dy": 0.0023857674095779657,
      "rmse_mean": 0.007056364323943853,
      "rotation_flip": 0.003350083716213703,
      "sparse_tokens": 32057.0,
      "step": 9539,
      "turn_loss": 0.0482608824968338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.44322616614012267,
      "grad_norm": 0.5231388807296753,
      "learning_rate": 1.0219916851704664e-06,
      "loss": 0.1176,
      "mae_dtheta": 0.017834270372986794,
      "mae_dx": 0.005326031241565943,
      "mae_dy": 0.004284785594791174,
      "pose_mae_dtheta": 0.1496434360742569,
      "pose_mae_dx": 0.029449565336108208,
      "pose_mae_dy": 0.05942228436470032,
      "pose_rmse_dtheta": 0.32996273040771484,
      "pose_rmse_dx": 0.06857435405254364,
      "pose_rmse_dy": 0.17174117267131805,
      "pose_rmse_mean": 0.1900927722454071,
      "rmse_dtheta": 0.03378473222255707,
      "rmse_dx": 0.013057397678494453,
      "rmse_dy": 0.008675366640090942,
      "rmse_mean": 0.01850583218038082,
      "rotation_flip": 0.0,
      "sparse_tokens": 4160.0,
      "step": 9540,
      "turn_loss": 0.18816323578357697,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.44327262590596545,
      "grad_norm": 0.4900752604007721,
      "learning_rate": 1.0211907973458391e-06,
      "loss": 0.1427,
      "mae_dtheta": 0.01122024655342102,
      "mae_dx": 0.002163706813007593,
      "mae_dy": 0.0036466005258262157,
      "pose_mae_dtheta": 0.07210101932287216,
      "pose_mae_dx": 0.03226235881447792,
      "pose_mae_dy": 0.03577166423201561,
      "pose_rmse_dtheta": 0.14032699167728424,
      "pose_rmse_dx": 0.07752756774425507,
      "pose_rmse_dy": 0.07582169771194458,
      "pose_rmse_mean": 0.09789209067821503,
      "rmse_dtheta": 0.020542645826935768,
      "rmse_dx": 0.005111020989716053,
      "rmse_dy": 0.007654471788555384,
      "rmse_mean": 0.011102713644504547,
      "rotation_flip": 0.004932587966322899,
      "sparse_tokens": 32121.0,
      "step": 9541,
      "turn_loss": 0.10696040093898773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4433190856718082,
      "grad_norm": 0.38153693079948425,
      "learning_rate": 1.020390187761477e-06,
      "loss": 0.0844,
      "mae_dtheta": 0.007692314218729734,
      "mae_dx": 0.002045694272965193,
      "mae_dy": 0.002663971157744527,
      "pose_mae_dtheta": 0.05398152023553848,
      "pose_mae_dx": 0.02756568044424057,
      "pose_mae_dy": 0.026267042383551598,
      "pose_rmse_dtheta": 0.12123839557170868,
      "pose_rmse_dx": 0.08320184051990509,
      "pose_rmse_dy": 0.06160798296332359,
      "pose_rmse_mean": 0.08868274092674255,
      "rmse_dtheta": 0.0158376544713974,
      "rmse_dx": 0.006074662785977125,
      "rmse_dy": 0.006148855667561293,
      "rmse_mean": 0.009353725239634514,
      "rotation_flip": 0.0018953753169625998,
      "sparse_tokens": 32089.0,
      "step": 9542,
      "turn_loss": 0.07865907996892929,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.443365545437651,
      "grad_norm": 0.4130609333515167,
      "learning_rate": 1.019589856473363e-06,
      "loss": 0.1115,
      "mae_dtheta": 0.010896706022322178,
      "mae_dx": 0.0017632051603868604,
      "mae_dy": 0.002279591280966997,
      "pose_mae_dtheta": 0.0663289725780487,
      "pose_mae_dx": 0.019966214895248413,
      "pose_mae_dy": 0.023976074531674385,
      "pose_rmse_dtheta": 0.16265875101089478,
      "pose_rmse_dx": 0.061290960758924484,
      "pose_rmse_dy": 0.05920826271176338,
      "pose_rmse_mean": 0.09438599646091461,
      "rmse_dtheta": 0.024181939661502838,
      "rmse_dx": 0.006145103368908167,
      "rmse_dy": 0.005819480866193771,
      "rmse_mean": 0.012048840522766113,
      "rotation_flip": 0.005922551266849041,
      "sparse_tokens": 32057.0,
      "step": 9543,
      "turn_loss": 0.09530778974294662,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.4434120052034938,
      "grad_norm": 0.8302708864212036,
      "learning_rate": 1.0187898035374683e-06,
      "loss": 0.1049,
      "mae_dtheta": 0.026182150468230247,
      "mae_dx": 0.01602465659379959,
      "mae_dy": 0.004099730867892504,
      "pose_mae_dtheta": 0.21081283688545227,
      "pose_mae_dx": 0.13048192858695984,
      "pose_mae_dy": 0.059446074068546295,
      "pose_rmse_dtheta": 0.40014374256134033,
      "pose_rmse_dx": 0.2915995717048645,
      "pose_rmse_dy": 0.16762270033359528,
      "pose_rmse_mean": 0.28645533323287964,
      "rmse_dtheta": 0.04389039799571037,
      "rmse_dx": 0.030359629541635513,
      "rmse_dy": 0.010016968473792076,
      "rmse_mean": 0.028088999912142754,
      "rotation_flip": 0.0055555556900799274,
      "sparse_tokens": 19625.0,
      "step": 9544,
      "turn_loss": 0.2156268060207367,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.44345846496933655,
      "grad_norm": 0.6283695697784424,
      "learning_rate": 1.0179900290097383e-06,
      "loss": 0.0936,
      "mae_dtheta": 0.01037129107862711,
      "mae_dx": 0.0011924494756385684,
      "mae_dy": 0.00019599843653850257,
      "pose_mae_dtheta": 0.07826292514801025,
      "pose_mae_dx": 0.008875753730535507,
      "pose_mae_dy": 0.0025294115766882896,
      "pose_rmse_dtheta": 0.3321109414100647,
      "pose_rmse_dx": 0.018539315089583397,
      "pose_rmse_dy": 0.0051071662455797195,
      "pose_rmse_mean": 0.11858581006526947,
      "rmse_dtheta": 0.03609626740217209,
      "rmse_dx": 0.0030756359919905663,
      "rmse_dy": 0.0004187033337075263,
      "rmse_mean": 0.013196869753301144,
      "rotation_flip": 0.0011154490057379007,
      "sparse_tokens": 32249.0,
      "step": 9545,
      "turn_loss": 0.04701913148164749,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.44350492473517933,
      "grad_norm": 0.4900820255279541,
      "learning_rate": 1.017190532946104e-06,
      "loss": 0.1054,
      "mae_dtheta": 0.026842275634407997,
      "mae_dx": 0.014689421281218529,
      "mae_dy": 0.002802632050588727,
      "pose_mae_dtheta": 0.18983875215053558,
      "pose_mae_dx": 0.10521034896373749,
      "pose_mae_dy": 0.022390691563487053,
      "pose_rmse_dtheta": 0.3517402708530426,
      "pose_rmse_dx": 0.2753450572490692,
      "pose_rmse_dy": 0.057091522961854935,
      "pose_rmse_mean": 0.22805896401405334,
      "rmse_dtheta": 0.047932662069797516,
      "rmse_dx": 0.03017078898847103,
      "rmse_dy": 0.006355544086545706,
      "rmse_mean": 0.02815300039947033,
      "rotation_flip": 0.018433179706335068,
      "sparse_tokens": 4027.0,
      "step": 9546,
      "turn_loss": 0.20815728604793549,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.4435513845010221,
      "grad_norm": 0.5541945695877075,
      "learning_rate": 1.0163913154024724e-06,
      "loss": 0.1275,
      "mae_dtheta": 0.00861023087054491,
      "mae_dx": 0.0021307645365595818,
      "mae_dy": 0.0030313744209706783,
      "pose_mae_dtheta": 0.06082993000745773,
      "pose_mae_dx": 0.027310512959957123,
      "pose_mae_dy": 0.034106768667697906,
      "pose_rmse_dtheta": 0.15472754836082458,
      "pose_rmse_dx": 0.09547366946935654,
      "pose_rmse_dy": 0.0953129380941391,
      "pose_rmse_mean": 0.1151713952422142,
      "rmse_dtheta": 0.01857566460967064,
      "rmse_dx": 0.008639574982225895,
      "rmse_dy": 0.007707926910370588,
      "rmse_mean": 0.011641055345535278,
      "rotation_flip": 0.0048971595242619514,
      "sparse_tokens": 32025.0,
      "step": 9547,
      "turn_loss": 0.0693909227848053,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4435978442668649,
      "grad_norm": 0.4402378797531128,
      "learning_rate": 1.0155923764347354e-06,
      "loss": 0.1145,
      "mae_dtheta": 0.009112599305808544,
      "mae_dx": 0.0015561450272798538,
      "mae_dy": 0.00250150915235281,
      "pose_mae_dtheta": 0.061168551445007324,
      "pose_mae_dx": 0.021954549476504326,
      "pose_mae_dy": 0.02644772082567215,
      "pose_rmse_dtheta": 0.16246944665908813,
      "pose_rmse_dx": 0.06703279167413712,
      "pose_rmse_dy": 0.07181048393249512,
      "pose_rmse_mean": 0.10043757408857346,
      "rmse_dtheta": 0.022139472886919975,
      "rmse_dx": 0.004632242955267429,
      "rmse_dy": 0.006391111295670271,
      "rmse_mean": 0.01105427648872137,
      "rotation_flip": 0.003433476435020566,
      "sparse_tokens": 32073.0,
      "step": 9548,
      "turn_loss": 0.07811950892210007,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.44364430403270766,
      "grad_norm": 0.2963436543941498,
      "learning_rate": 1.0147937160987603e-06,
      "loss": 0.0583,
      "mae_dtheta": 0.008371002040803432,
      "mae_dx": 0.0013534565223380923,
      "mae_dy": 0.001411010860465467,
      "pose_mae_dtheta": 0.053489748388528824,
      "pose_mae_dx": 0.015234902501106262,
      "pose_mae_dy": 0.020913025364279747,
      "pose_rmse_dtheta": 0.13182884454727173,
      "pose_rmse_dx": 0.04311913996934891,
      "pose_rmse_dy": 0.0531531423330307,
      "pose_rmse_mean": 0.07603371143341064,
      "rmse_dtheta": 0.018866393715143204,
      "rmse_dx": 0.0046076360158622265,
      "rmse_dy": 0.002988651394844055,
      "rmse_mean": 0.008820894174277782,
      "rotation_flip": 0.004125838167965412,
      "sparse_tokens": 32073.0,
      "step": 9549,
      "turn_loss": 0.06179729104042053,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.44369076379855044,
      "grad_norm": 0.40322303771972656,
      "learning_rate": 1.0139953344504017e-06,
      "loss": 0.0785,
      "mae_dtheta": 0.004359886981546879,
      "mae_dx": 0.0008776811300776899,
      "mae_dy": 0.0006436067051254213,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.40322306752204895,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 164.14805603027344,
      "model/head/act_norm_mean": 121.57247277462122,
      "model/head/act_norm_min": 85.38544464111328,
      "model/head/act_over_embed": 83.54574147014213,
      "model/head/grad_frac": 0.08935809135437012,
      "model/head/grad_norm": 0.036031242460012436,
      "model/head/grad_zero_frac": 0.0001935357868205756,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7003827335858586,
      "model/head/update_ratio": 0.0006134629948064685,
      "model/head/weight_delta": 9.918116569519043,
      "model/head/weight_delta_rel": 0.17399314045906067,
      "model/head/weight_norm": 58.73417282104492,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4227854907512665,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227186026552175,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226381778717041,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904961812985758,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08468112349510193,
      "model/modality_embedder.encoders.pose/grad_norm": 0.034145381301641464,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.537625619493392,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011025520507246256,
      "model/modality_embedder.encoders.pose/weight_delta": 3.140766143798828,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10261861979961395,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969406127929688,
      "model/modality_embedder/grad_frac": 0.08468112349510193,
      "model/modality_embedder/grad_norm": 0.034145381301641464,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.537625619493392,
      "model/modality_embedder/update_ratio": 0.0011025520507246256,
      "model/modality_embedder/weight_delta": 3.140766143798828,
      "model/modality_embedder/weight_delta_rel": 0.10261861979961395,
      "model/modality_embedder/weight_norm": 30.969406127929688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.43558502197266,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.697783890492225,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.065237045288086,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.972548313842037,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05125037208199501,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.020665332674980164,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00031270174076780677,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007392909028567374,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.705963373184204,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09860693663358688,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.952911376953125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.1676254272461,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.70348324514991,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.28189754486084,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.663674325868502,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05511484667658806,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0222235769033432,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00030765816336497664,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007468144758604467,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.431239604949951,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11886081844568253,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.757827758789062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.0987777709961,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.49163760622094,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.379919052124023,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.8925107437614,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05316601321101189,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.021437762305140495,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00032783247297629714,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0006976579315960407,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7149062156677246,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12473959475755692,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.728185653686523,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.80006408691406,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.12567390171557,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.4807710647583,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.015435784114132,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05022645741701126,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.020252466201782227,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000322788895573467,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006763355922885239,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.190453052520752,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10903454571962357,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.94440269470215,
      "model/normalizer/grad_frac": 0.1737077534198761,
      "model/normalizer/grad_norm": 0.07004297524690628,
      "model/normalizer/grad_zero_frac": 0.00030370676540769637,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.000890642695594579,
      "model/normalizer/weight_delta": 6.715864181518555,
      "model/normalizer/weight_delta_rel": 0.08649644255638123,
      "model/normalizer/weight_norm": 78.64318084716797,
      "pose_mae_dtheta": 0.029628222808241844,
      "pose_mae_dx": 0.006949259899556637,
      "pose_mae_dy": 0.008914335630834103,
      "pose_rmse_dtheta": 0.09397197514772415,
      "pose_rmse_dx": 0.01677197590470314,
      "pose_rmse_dy": 0.019206225872039795,
      "pose_rmse_mean": 0.04331672936677933,
      "rmse_dtheta": 0.014316679909825325,
      "rmse_dx": 0.0026003853417932987,
      "rmse_dy": 0.0013367114588618279,
      "rmse_mean": 0.006084592547267675,
      "rotation_flip": 0.0021574972197413445,
      "sparse_tokens": 32137.0,
      "step": 9550,
      "turn_loss": 0.03310741111636162,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4437372235643932,
      "grad_norm": 0.3930360972881317,
      "learning_rate": 1.0131972315454868e-06,
      "loss": 0.0694,
      "mae_dtheta": 0.005943147465586662,
      "mae_dx": 0.0015013528754934669,
      "mae_dy": 0.0013485393719747663,
      "pose_mae_dtheta": 0.04578329622745514,
      "pose_mae_dx": 0.013615368865430355,
      "pose_mae_dy": 0.01596806012094021,
      "pose_rmse_dtheta": 0.18030430376529694,
      "pose_rmse_dx": 0.06429029256105423,
      "pose_rmse_dy": 0.05839470028877258,
      "pose_rmse_mean": 0.10099643468856812,
      "rmse_dtheta": 0.020125865936279297,
      "rmse_dx": 0.006402484141290188,
      "rmse_dy": 0.0056761885061860085,
      "rmse_mean": 0.01073484681546688,
      "rotation_flip": 0.0020408162381500006,
      "sparse_tokens": 32073.0,
      "step": 9551,
      "turn_loss": 0.05103360861539841,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25311.0,
      "epoch": 0.443783683330236,
      "grad_norm": 1.083268165588379,
      "learning_rate": 1.0123994074398313e-06,
      "loss": 0.2737,
      "mae_dtheta": 0.030453359708189964,
      "mae_dx": 0.010305576026439667,
      "mae_dy": 0.004427560139447451,
      "pose_mae_dtheta": 0.24792860448360443,
      "pose_mae_dx": 0.07872024178504944,
      "pose_mae_dy": 0.0627247765660286,
      "pose_rmse_dtheta": 0.4611828327178955,
      "pose_rmse_dx": 0.19396980106830597,
      "pose_rmse_dy": 0.169708713889122,
      "pose_rmse_mean": 0.27495378255844116,
      "rmse_dtheta": 0.04856688156723976,
      "rmse_dx": 0.0228677149862051,
      "rmse_dy": 0.009290381334722042,
      "rmse_mean": 0.026908326894044876,
      "rotation_flip": 0.004149377811700106,
      "sparse_tokens": 18132.0,
      "step": 9552,
      "turn_loss": 0.2328314185142517,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4438301430960788,
      "grad_norm": 0.4606390595436096,
      "learning_rate": 1.0116018621892237e-06,
      "loss": 0.0865,
      "mae_dtheta": 0.008155044168233871,
      "mae_dx": 0.0013418450253084302,
      "mae_dy": 0.0024547060020267963,
      "pose_mae_dtheta": 0.05136441811919212,
      "pose_mae_dx": 0.020856549963355064,
      "pose_mae_dy": 0.02366846241056919,
      "pose_rmse_dtheta": 0.13431724905967712,
      "pose_rmse_dx": 0.052401669323444366,
      "pose_rmse_dy": 0.05041557550430298,
      "pose_rmse_mean": 0.07904483377933502,
      "rmse_dtheta": 0.018623391166329384,
      "rmse_dx": 0.00353780179284513,
      "rmse_dy": 0.005031737964600325,
      "rmse_mean": 0.009064311161637306,
      "rotation_flip": 0.002863278379663825,
      "sparse_tokens": 32089.0,
      "step": 9553,
      "turn_loss": 0.06407222151756287,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4438766028619216,
      "grad_norm": 0.6115273237228394,
      "learning_rate": 1.010804595849439e-06,
      "loss": 0.1402,
      "mae_dtheta": 0.012153285555541515,
      "mae_dx": 0.0020383019000291824,
      "mae_dy": 0.00325325271114707,
      "pose_mae_dtheta": 0.0797387883067131,
      "pose_mae_dx": 0.02493385598063469,
      "pose_mae_dy": 0.033964961767196655,
      "pose_rmse_dtheta": 0.18161530792713165,
      "pose_rmse_dx": 0.07641977816820145,
      "pose_rmse_dy": 0.10580489784479141,
      "pose_rmse_mean": 0.1212799996137619,
      "rmse_dtheta": 0.02357248030602932,
      "rmse_dx": 0.006718621589243412,
      "rmse_dy": 0.008692706935107708,
      "rmse_mean": 0.01299460418522358,
      "rotation_flip": 0.005876252893358469,
      "sparse_tokens": 32089.0,
      "step": 9554,
      "turn_loss": 0.10504637658596039,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4439230626277644,
      "grad_norm": 0.5204635858535767,
      "learning_rate": 1.010007608476231e-06,
      "loss": 0.0992,
      "mae_dtheta": 0.008553673513233662,
      "mae_dx": 0.001306956517510116,
      "mae_dy": 0.0020060876850038767,
      "pose_mae_dtheta": 0.05965438857674599,
      "pose_mae_dx": 0.0175210852175951,
      "pose_mae_dy": 0.02191290445625782,
      "pose_rmse_dtheta": 0.1895199418067932,
      "pose_rmse_dx": 0.043415751308202744,
      "pose_rmse_dy": 0.05333609879016876,
      "pose_rmse_mean": 0.09542393684387207,
      "rmse_dtheta": 0.021903567016124725,
      "rmse_dx": 0.0036457323003560305,
      "rmse_dy": 0.004529772326350212,
      "rmse_mean": 0.01002635806798935,
      "rotation_flip": 0.004275331273674965,
      "sparse_tokens": 32073.0,
      "step": 9555,
      "turn_loss": 0.06941960752010345,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.44396952239360715,
      "grad_norm": 0.5709620118141174,
      "learning_rate": 1.0092109001253314e-06,
      "loss": 0.1036,
      "mae_dtheta": 0.027583979070186615,
      "mae_dx": 0.0074491947889328,
      "mae_dy": 0.004410929512232542,
      "pose_mae_dtheta": 0.17231899499893188,
      "pose_mae_dx": 0.06815782189369202,
      "pose_mae_dy": 0.04947418347001076,
      "pose_rmse_dtheta": 0.3237975537776947,
      "pose_rmse_dx": 0.13977670669555664,
      "pose_rmse_dy": 0.10173522680997849,
      "pose_rmse_mean": 0.18843649327754974,
      "rmse_dtheta": 0.04500711336731911,
      "rmse_dx": 0.016130436211824417,
      "rmse_dy": 0.008570975624024868,
      "rmse_mean": 0.023236175999045372,
      "rotation_flip": 0.016025641933083534,
      "sparse_tokens": 5423.0,
      "step": 9556,
      "turn_loss": 0.2878022789955139,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.44401598215944993,
      "grad_norm": 0.5558582544326782,
      "learning_rate": 1.0084144708524568e-06,
      "loss": 0.1061,
      "mae_dtheta": 0.005913822446018457,
      "mae_dx": 0.001002701697871089,
      "mae_dy": 0.00039663451025262475,
      "pose_mae_dtheta": 0.04306839779019356,
      "pose_mae_dx": 0.007835198193788528,
      "pose_mae_dy": 0.005398526322096586,
      "pose_rmse_dtheta": 0.18925264477729797,
      "pose_rmse_dx": 0.01607312075793743,
      "pose_rmse_dy": 0.019035497680306435,
      "pose_rmse_mean": 0.07478709518909454,
      "rmse_dtheta": 0.02288576401770115,
      "rmse_dx": 0.00265891058370471,
      "rmse_dy": 0.0010176036739721894,
      "rmse_mean": 0.0088540930300951,
      "rotation_flip": 0.0030487803742289543,
      "sparse_tokens": 32233.0,
      "step": 9557,
      "turn_loss": 0.03494253009557724,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4440624419252927,
      "grad_norm": 0.6433778405189514,
      "learning_rate": 1.0076183207132994e-06,
      "loss": 0.1125,
      "mae_dtheta": 0.011461295187473297,
      "mae_dx": 0.0030616929288953543,
      "mae_dy": 0.00410463334992528,
      "pose_mae_dtheta": 0.07488031685352325,
      "pose_mae_dx": 0.034637629985809326,
      "pose_mae_dy": 0.036541085690259933,
      "pose_rmse_dtheta": 0.16011641919612885,
      "pose_rmse_dx": 0.08993592858314514,
      "pose_rmse_dy": 0.09252650290727615,
      "pose_rmse_mean": 0.11419294774532318,
      "rmse_dtheta": 0.023557420819997787,
      "rmse_dx": 0.008411498740315437,
      "rmse_dy": 0.010291672311723232,
      "rmse_mean": 0.01408686488866806,
      "rotation_flip": 0.007285974454134703,
      "sparse_tokens": 32121.0,
      "step": 9558,
      "turn_loss": 0.11926516890525818,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31791.0,
      "epoch": 0.4441089016911355,
      "grad_norm": 0.6311115622520447,
      "learning_rate": 1.006822449763537e-06,
      "loss": 0.1777,
      "mae_dtheta": 0.030168971046805382,
      "mae_dx": 0.009433112107217312,
      "mae_dy": 0.0035278969444334507,
      "pose_mae_dtheta": 0.2094670683145523,
      "pose_mae_dx": 0.06401631236076355,
      "pose_mae_dy": 0.044205423444509506,
      "pose_rmse_dtheta": 0.4070790112018585,
      "pose_rmse_dx": 0.1765107810497284,
      "pose_rmse_dy": 0.11175643652677536,
      "pose_rmse_mean": 0.23178207874298096,
      "rmse_dtheta": 0.04790481552481651,
      "rmse_dx": 0.02139647863805294,
      "rmse_dy": 0.007099140901118517,
      "rmse_mean": 0.025466812774538994,
      "rotation_flip": 0.009187279269099236,
      "sparse_tokens": 24065.0,
      "step": 9559,
      "turn_loss": 0.23116080462932587,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.44415536145697826,
      "grad_norm": 0.7844527959823608,
      "learning_rate": 1.0060268580588222e-06,
      "loss": 0.2163,
      "mae_dtheta": 0.033903367817401886,
      "mae_dx": 0.014335169456899166,
      "mae_dy": 0.005609431304037571,
      "pose_mae_dtheta": 0.27235811948776245,
      "pose_mae_dx": 0.10923431068658829,
      "pose_mae_dy": 0.0625792071223259,
      "pose_rmse_dtheta": 0.43834808468818665,
      "pose_rmse_dx": 0.21467886865139008,
      "pose_rmse_dy": 0.13731525838375092,
      "pose_rmse_mean": 0.2634474039077759,
      "rmse_dtheta": 0.05212775245308876,
      "rmse_dx": 0.02653437666594982,
      "rmse_dy": 0.010881813243031502,
      "rmse_mean": 0.02984797954559326,
      "rotation_flip": 0.01826483942568302,
      "sparse_tokens": 3341.0,
      "step": 9560,
      "turn_loss": 0.30950725078582764,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.44420182122282104,
      "grad_norm": 1.002555251121521,
      "learning_rate": 1.0052315456547934e-06,
      "loss": 0.1554,
      "mae_dtheta": 0.040623988956213,
      "mae_dx": 0.008569065481424332,
      "mae_dy": 0.0035041572991758585,
      "pose_mae_dtheta": 0.32183751463890076,
      "pose_mae_dx": 0.054577503353357315,
      "pose_mae_dy": 0.03592127561569214,
      "pose_rmse_dtheta": 0.5734067559242249,
      "pose_rmse_dx": 0.1418042778968811,
      "pose_rmse_dy": 0.07991281151771545,
      "pose_rmse_mean": 0.2650412917137146,
      "rmse_dtheta": 0.061569035053253174,
      "rmse_dx": 0.01951630599796772,
      "rmse_dy": 0.006884696893393993,
      "rmse_mean": 0.02932334505021572,
      "rotation_flip": 0.019375672563910484,
      "sparse_tokens": 14814.0,
      "step": 9561,
      "turn_loss": 0.2350025475025177,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.4442482809886638,
      "grad_norm": 0.5554282069206238,
      "learning_rate": 1.0044365126070683e-06,
      "loss": 0.1005,
      "mae_dtheta": 0.04000505059957504,
      "mae_dx": 0.012036117725074291,
      "mae_dy": 0.009477987885475159,
      "pose_mae_dtheta": 0.2909652888774872,
      "pose_mae_dx": 0.10607492178678513,
      "pose_mae_dy": 0.12158718705177307,
      "pose_rmse_dtheta": 0.4614940583705902,
      "pose_rmse_dx": 0.2000223994255066,
      "pose_rmse_dy": 0.2119806557893753,
      "pose_rmse_mean": 0.29116570949554443,
      "rmse_dtheta": 0.05657283216714859,
      "rmse_dx": 0.021668609231710434,
      "rmse_dy": 0.017729109153151512,
      "rmse_mean": 0.031990185379981995,
      "rotation_flip": 0.02593659982085228,
      "sparse_tokens": 5267.0,
      "step": 9562,
      "turn_loss": 0.3910451829433441,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.4442947407545066,
      "grad_norm": 0.4875023663043976,
      "learning_rate": 1.0036417589712405e-06,
      "loss": 0.1015,
      "mae_dtheta": 0.02794073149561882,
      "mae_dx": 0.0049488418735563755,
      "mae_dy": 0.0035702064633369446,
      "pose_mae_dtheta": 0.22509366273880005,
      "pose_mae_dx": 0.051367469131946564,
      "pose_mae_dy": 0.043551716953516006,
      "pose_rmse_dtheta": 0.4394975006580353,
      "pose_rmse_dx": 0.1208864375948906,
      "pose_rmse_dy": 0.10109482705593109,
      "pose_rmse_mean": 0.22049292922019958,
      "rmse_dtheta": 0.04635755717754364,
      "rmse_dx": 0.013093615882098675,
      "rmse_dy": 0.006762013304978609,
      "rmse_mean": 0.02207106351852417,
      "rotation_flip": 0.01295896340161562,
      "sparse_tokens": 8601.0,
      "step": 9563,
      "turn_loss": 0.19678445160388947,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.44434120052034937,
      "grad_norm": 0.4400814175605774,
      "learning_rate": 1.0028472848028915e-06,
      "loss": 0.1013,
      "mae_dtheta": 0.0068840766325592995,
      "mae_dx": 0.0011966374004259706,
      "mae_dy": 0.0016638635424897075,
      "pose_mae_dtheta": 0.04252002015709877,
      "pose_mae_dx": 0.013632101938128471,
      "pose_mae_dy": 0.018489446491003036,
      "pose_rmse_dtheta": 0.1524362415075302,
      "pose_rmse_dx": 0.05888880416750908,
      "pose_rmse_dy": 0.05291818082332611,
      "pose_rmse_mean": 0.08808108419179916,
      "rmse_dtheta": 0.018884634599089622,
      "rmse_dx": 0.004979661200195551,
      "rmse_dy": 0.005566589999943972,
      "rmse_mean": 0.009810294955968857,
      "rotation_flip": 0.008166968822479248,
      "sparse_tokens": 32105.0,
      "step": 9564,
      "turn_loss": 0.06449809670448303,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.44438766028619214,
      "grad_norm": 0.4653686285018921,
      "learning_rate": 1.0020530901575754e-06,
      "loss": 0.095,
      "mae_dtheta": 0.018445152789354324,
      "mae_dx": 0.005111492704600096,
      "mae_dy": 0.0056427461095154285,
      "pose_mae_dtheta": 0.16332760453224182,
      "pose_mae_dx": 0.04879412055015564,
      "pose_mae_dy": 0.09882862865924835,
      "pose_rmse_dtheta": 0.2938721776008606,
      "pose_rmse_dx": 0.1254357397556305,
      "pose_rmse_dy": 0.19725096225738525,
      "pose_rmse_mean": 0.2055196464061737,
      "rmse_dtheta": 0.031170764937996864,
      "rmse_dx": 0.016262132674455643,
      "rmse_dy": 0.009911895729601383,
      "rmse_mean": 0.019114932045340538,
      "rotation_flip": 0.007481296546757221,
      "sparse_tokens": 10333.0,
      "step": 9565,
      "turn_loss": 0.13439494371414185,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.4444341200520349,
      "grad_norm": 0.39406007528305054,
      "learning_rate": 1.001259175090834e-06,
      "loss": 0.098,
      "mae_dtheta": 0.037750568240880966,
      "mae_dx": 0.008482364006340504,
      "mae_dy": 0.002827258314937353,
      "pose_mae_dtheta": 0.2686954736709595,
      "pose_mae_dx": 0.07329726964235306,
      "pose_mae_dy": 0.04756627604365349,
      "pose_rmse_dtheta": 0.5107856392860413,
      "pose_rmse_dx": 0.20209966599941254,
      "pose_rmse_dy": 0.1362132430076599,
      "pose_rmse_mean": 0.2830328643321991,
      "rmse_dtheta": 0.059466298669576645,
      "rmse_dx": 0.020578863099217415,
      "rmse_dy": 0.007008218206465244,
      "rmse_mean": 0.029017794877290726,
      "rotation_flip": 0.018711019307374954,
      "sparse_tokens": 7916.0,
      "step": 9566,
      "turn_loss": 0.21620596945285797,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4444805798178777,
      "grad_norm": 0.45000141859054565,
      "learning_rate": 1.000465539658183e-06,
      "loss": 0.1188,
      "mae_dtheta": 0.007983554154634476,
      "mae_dx": 0.0022942994255572557,
      "mae_dy": 0.002361229620873928,
      "pose_mae_dtheta": 0.04870418459177017,
      "pose_mae_dx": 0.023268895223736763,
      "pose_mae_dy": 0.02784884348511696,
      "pose_rmse_dtheta": 0.11340396106243134,
      "pose_rmse_dx": 0.0693332627415657,
      "pose_rmse_dy": 0.07781524956226349,
      "pose_rmse_mean": 0.08685082197189331,
      "rmse_dtheta": 0.018872998654842377,
      "rmse_dx": 0.007758066989481449,
      "rmse_dy": 0.006278242915868759,
      "rmse_mean": 0.010969769209623337,
      "rotation_flip": 0.008053691126406193,
      "sparse_tokens": 32073.0,
      "step": 9567,
      "turn_loss": 0.09368676692247391,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.4445270395837205,
      "grad_norm": 0.5943540334701538,
      "learning_rate": 9.996721839151242e-07,
      "loss": 0.1394,
      "mae_dtheta": 0.046989716589450836,
      "mae_dx": 0.016332920640707016,
      "mae_dy": 0.0027032706420868635,
      "pose_mae_dtheta": 0.3839206397533417,
      "pose_mae_dx": 0.14163702726364136,
      "pose_mae_dy": 0.05314245820045471,
      "pose_rmse_dtheta": 0.5904508829116821,
      "pose_rmse_dx": 0.26800474524497986,
      "pose_rmse_dy": 0.12612269818782806,
      "pose_rmse_mean": 0.328192800283432,
      "rmse_dtheta": 0.06480417400598526,
      "rmse_dx": 0.028238102793693542,
      "rmse_dy": 0.005901204887777567,
      "rmse_mean": 0.032981161028146744,
      "rotation_flip": 0.01293103490024805,
      "sparse_tokens": 3736.0,
      "step": 9568,
      "turn_loss": 0.27062851190567017,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4445734993495633,
      "grad_norm": 0.425528883934021,
      "learning_rate": 9.988791079171378e-07,
      "loss": 0.0967,
      "mae_dtheta": 0.006782135926187038,
      "mae_dx": 0.0015355825889855623,
      "mae_dy": 0.0018246476538479328,
      "pose_mae_dtheta": 0.046719036996364594,
      "pose_mae_dx": 0.020029103383421898,
      "pose_mae_dy": 0.019745487719774246,
      "pose_rmse_dtheta": 0.1041288822889328,
      "pose_rmse_dx": 0.05850481241941452,
      "pose_rmse_dy": 0.05203127861022949,
      "pose_rmse_mean": 0.0715549886226654,
      "rmse_dtheta": 0.015490369871258736,
      "rmse_dx": 0.0045777661725878716,
      "rmse_dy": 0.004142575431615114,
      "rmse_mean": 0.008070237003266811,
      "rotation_flip": 0.005739514250308275,
      "sparse_tokens": 32121.0,
      "step": 9569,
      "turn_loss": 0.06412657350301743,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4446199591154061,
      "grad_norm": 0.29942047595977783,
      "learning_rate": 9.980863117196816e-07,
      "loss": 0.092,
      "mae_dtheta": 0.009104352444410324,
      "mae_dx": 0.0009493418619967997,
      "mae_dy": 0.0018785957945510745,
      "pose_mae_dtheta": 0.057963304221630096,
      "pose_mae_dx": 0.012486962601542473,
      "pose_mae_dy": 0.021477345377206802,
      "pose_rmse_dtheta": 0.18303023278713226,
      "pose_rmse_dx": 0.03250841796398163,
      "pose_rmse_dy": 0.05089407041668892,
      "pose_rmse_mean": 0.08881091326475143,
      "rmse_dtheta": 0.021965011954307556,
      "rmse_dx": 0.0027657365426421165,
      "rmse_dy": 0.004129573702812195,
      "rmse_mean": 0.00962010771036148,
      "rotation_flip": 0.005877034272998571,
      "sparse_tokens": 32073.0,
      "step": 9570,
      "turn_loss": 0.07620403170585632,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24338.0,
      "epoch": 0.44466641888124886,
      "grad_norm": 0.6840223073959351,
      "learning_rate": 9.972937953781985e-07,
      "loss": 0.1595,
      "mae_dtheta": 0.0390002578496933,
      "mae_dx": 0.009291003458201885,
      "mae_dy": 0.003164451802149415,
      "pose_mae_dtheta": 0.3102976679801941,
      "pose_mae_dx": 0.07428611814975739,
      "pose_mae_dy": 0.030425142496824265,
      "pose_rmse_dtheta": 0.5441610813140869,
      "pose_rmse_dx": 0.1656295508146286,
      "pose_rmse_dy": 0.0834876075387001,
      "pose_rmse_mean": 0.2644261121749878,
      "rmse_dtheta": 0.059126317501068115,
      "rmse_dx": 0.01971113309264183,
      "rmse_dy": 0.007174425292760134,
      "rmse_mean": 0.028670627623796463,
      "rotation_flip": 0.008598452433943748,
      "sparse_tokens": 19211.0,
      "step": 9571,
      "turn_loss": 0.27057546377182007,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 26525.0,
      "epoch": 0.44471287864709164,
      "grad_norm": 0.695950448513031,
      "learning_rate": 9.965015589481075e-07,
      "loss": 0.1886,
      "mae_dtheta": 0.03573865815997124,
      "mae_dx": 0.016078954562544823,
      "mae_dy": 0.0051981075666844845,
      "pose_mae_dtheta": 0.3043757379055023,
      "pose_mae_dx": 0.1333046406507492,
      "pose_mae_dy": 0.06976290047168732,
      "pose_rmse_dtheta": 0.520190417766571,
      "pose_rmse_dx": 0.277005136013031,
      "pose_rmse_dy": 0.16255618631839752,
      "pose_rmse_mean": 0.3199172616004944,
      "rmse_dtheta": 0.05259427800774574,
      "rmse_dx": 0.029494933784008026,
      "rmse_dy": 0.010613398626446724,
      "rmse_mean": 0.030900871381163597,
      "rotation_flip": 0.011299435049295425,
      "sparse_tokens": 20381.0,
      "step": 9572,
      "turn_loss": 0.3318173885345459,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.4447593384129344,
      "grad_norm": 1.5889067649841309,
      "learning_rate": 9.957096024848117e-07,
      "loss": 0.2306,
      "mae_dtheta": 0.032916370779275894,
      "mae_dx": 0.013080107048153877,
      "mae_dy": 0.0046953256241977215,
      "pose_mae_dtheta": 0.24572065472602844,
      "pose_mae_dx": 0.10969783365726471,
      "pose_mae_dy": 0.049903277307748795,
      "pose_rmse_dtheta": 0.44912847876548767,
      "pose_rmse_dx": 0.24302630126476288,
      "pose_rmse_dy": 0.10691017657518387,
      "pose_rmse_mean": 0.2663549780845642,
      "rmse_dtheta": 0.05380995199084282,
      "rmse_dx": 0.02635188214480877,
      "rmse_dy": 0.010157001204788685,
      "rmse_mean": 0.030106279999017715,
      "rotation_flip": 0.007662835065275431,
      "sparse_tokens": 9464.0,
      "step": 9573,
      "turn_loss": 0.22331565618515015,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4448057981787772,
      "grad_norm": 0.3853878974914551,
      "learning_rate": 9.949179260436936e-07,
      "loss": 0.0965,
      "mae_dtheta": 0.007501962594687939,
      "mae_dx": 0.0013012528652325273,
      "mae_dy": 0.001538313808850944,
      "pose_mae_dtheta": 0.04895435646176338,
      "pose_mae_dx": 0.015503779985010624,
      "pose_mae_dy": 0.0187363363802433,
      "pose_rmse_dtheta": 0.14564530551433563,
      "pose_rmse_dx": 0.04916195198893547,
      "pose_rmse_dy": 0.047878067940473557,
      "pose_rmse_mean": 0.08089511096477509,
      "rmse_dtheta": 0.020262323319911957,
      "rmse_dx": 0.0046288128942251205,
      "rmse_dy": 0.004959156736731529,
      "rmse_mean": 0.009950097650289536,
      "rotation_flip": 0.002402690937742591,
      "sparse_tokens": 32105.0,
      "step": 9574,
      "turn_loss": 0.060505460947752,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.44485225794461997,
      "grad_norm": 0.39797958731651306,
      "learning_rate": 9.941265296801134e-07,
      "loss": 0.0885,
      "mae_dtheta": 0.05010046809911728,
      "mae_dx": 0.01183609664440155,
      "mae_dy": 0.004671798553317785,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.39797964692115784,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.3914794921875,
      "model/head/act_norm_mean": 101.67345377604167,
      "model/head/act_norm_min": 65.2291488647461,
      "model/head/act_over_embed": 69.87094931676722,
      "model/head/grad_frac": 0.10404106229543686,
      "model/head/grad_norm": 0.04140622541308403,
      "model/head/grad_zero_frac": 0.00019702577264979482,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6940104166666666,
      "model/head/update_ratio": 0.0007049728301353753,
      "model/head/weight_delta": 9.919757843017578,
      "model/head/weight_delta_rel": 0.17402192950248718,
      "model/head/weight_norm": 58.7344970703125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42270779609680176,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42270779609680176,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42270779609680176,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904887549304599,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07842624932527542,
      "model/modality_embedder.encoders.pose/grad_norm": 0.031212052330374718,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010078323539346457,
      "model/modality_embedder.encoders.pose/weight_delta": 3.141974925994873,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10265811532735825,
      "model/modality_embedder.encoders.pose/weight_norm": 30.9694881439209,
      "model/modality_embedder/grad_frac": 0.07842624932527542,
      "model/modality_embedder/grad_norm": 0.031212052330374718,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0010078323539346457,
      "model/modality_embedder/weight_delta": 3.141974925994873,
      "model/modality_embedder/weight_delta_rel": 0.10265811532735825,
      "model/modality_embedder/weight_norm": 30.9694881439209,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.8103256225586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.895587384259258,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.329262733459473,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.734062002329223,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06340481340885162,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02523382566869259,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009027159539982677,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7070298194885254,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09864579886198044,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.953227996826172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.34564971923828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.696236359126985,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.94416332244873,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.284275473652126,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0668598860502243,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.026608873158693314,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008941686246544123,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.432638168334961,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11890926957130432,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.75822639465332,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.21392059326172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.260183118386244,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.216950416564941,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.359034328515335,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06496314704418182,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02585401013493538,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008413688046857715,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.716317892074585,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12478699535131454,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.7285099029541,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.17252349853516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.081746031746032,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.149888038635254,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.61082941631686,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0671573132276535,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02672724239528179,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.000892550393473357,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1918318271636963,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10908166319131851,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.944799423217773,
      "model/normalizer/grad_frac": 0.23768708109855652,
      "model/normalizer/grad_norm": 0.09459462016820908,
      "model/normalizer/grad_zero_frac": 0.00021389465837273747,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0012028261553496122,
      "model/normalizer/weight_delta": 6.718570232391357,
      "model/normalizer/weight_delta_rel": 0.08653129637241364,
      "model/normalizer/weight_norm": 78.64363098144531,
      "pose_mae_dtheta": 0.3935406506061554,
      "pose_mae_dx": 0.08845808357000351,
      "pose_mae_dy": 0.04316231980919838,
      "pose_rmse_dtheta": 0.619259774684906,
      "pose_rmse_dx": 0.17046263813972473,
      "pose_rmse_dy": 0.10357774049043655,
      "pose_rmse_mean": 0.2977667450904846,
      "rmse_dtheta": 0.06811588257551193,
      "rmse_dx": 0.02203597128391266,
      "rmse_dy": 0.012027919292449951,
      "rmse_mean": 0.034059926867485046,
      "rotation_flip": 0.006085192784667015,
      "sparse_tokens": 7669.0,
      "step": 9575,
      "turn_loss": 0.306702584028244,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.44489871771046274,
      "grad_norm": 0.509952962398529,
      "learning_rate": 9.933354134494167e-07,
      "loss": 0.118,
      "mae_dtheta": 0.012893195264041424,
      "mae_dx": 0.0019901583436876535,
      "mae_dy": 0.0019422798650339246,
      "pose_mae_dtheta": 0.09275384247303009,
      "pose_mae_dx": 0.023669114336371422,
      "pose_mae_dy": 0.0305387694388628,
      "pose_rmse_dtheta": 0.25949907302856445,
      "pose_rmse_dx": 0.059521786868572235,
      "pose_rmse_dy": 0.07553628087043762,
      "pose_rmse_mean": 0.13151904940605164,
      "rmse_dtheta": 0.029061153531074524,
      "rmse_dx": 0.00683930329978466,
      "rmse_dy": 0.0038282168097794056,
      "rmse_mean": 0.013242891989648342,
      "rotation_flip": 0.0028305700980126858,
      "sparse_tokens": 32057.0,
      "step": 9576,
      "turn_loss": 0.09847494214773178,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8437.0,
      "epoch": 0.4449451774763055,
      "grad_norm": 0.6113868951797485,
      "learning_rate": 9.925445774069232e-07,
      "loss": 0.1381,
      "mae_dtheta": 0.03260966017842293,
      "mae_dx": 0.010989680886268616,
      "mae_dy": 0.00766132352873683,
      "pose_mae_dtheta": 0.27730637788772583,
      "pose_mae_dx": 0.07858413457870483,
      "pose_mae_dy": 0.0920981839299202,
      "pose_rmse_dtheta": 0.5347283482551575,
      "pose_rmse_dx": 0.19384591281414032,
      "pose_rmse_dy": 0.22127322852611542,
      "pose_rmse_mean": 0.31661584973335266,
      "rmse_dtheta": 0.05426838994026184,
      "rmse_dx": 0.024210525676608086,
      "rmse_dy": 0.015717877075076103,
      "rmse_mean": 0.03139893338084221,
      "rotation_flip": 0.018324607983231544,
      "sparse_tokens": 6555.0,
      "step": 9577,
      "turn_loss": 0.26714378595352173,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4449916372421483,
      "grad_norm": 0.396514356136322,
      "learning_rate": 9.917540216079403e-07,
      "loss": 0.0797,
      "mae_dtheta": 0.009082164615392685,
      "mae_dx": 0.001658500055782497,
      "mae_dy": 0.002665354171767831,
      "pose_mae_dtheta": 0.05660032480955124,
      "pose_mae_dx": 0.020000923424959183,
      "pose_mae_dy": 0.025876684114336967,
      "pose_rmse_dtheta": 0.130146324634552,
      "pose_rmse_dx": 0.05339530482888222,
      "pose_rmse_dy": 0.06365003436803818,
      "pose_rmse_mean": 0.0823972225189209,
      "rmse_dtheta": 0.018246565014123917,
      "rmse_dx": 0.004154158290475607,
      "rmse_dy": 0.005790323950350285,
      "rmse_mean": 0.00939701683819294,
      "rotation_flip": 0.004496714100241661,
      "sparse_tokens": 32121.0,
      "step": 9578,
      "turn_loss": 0.08078128099441528,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.4450380970079911,
      "grad_norm": 0.7501926422119141,
      "learning_rate": 9.909637461077482e-07,
      "loss": 0.1759,
      "mae_dtheta": 0.01957513391971588,
      "mae_dx": 0.006594320759177208,
      "mae_dy": 0.0033890896011143923,
      "pose_mae_dtheta": 0.12783466279506683,
      "pose_mae_dx": 0.05071881040930748,
      "pose_mae_dy": 0.04334629699587822,
      "pose_rmse_dtheta": 0.29444992542266846,
      "pose_rmse_dx": 0.15765662491321564,
      "pose_rmse_dy": 0.11507246643304825,
      "pose_rmse_mean": 0.18905967473983765,
      "rmse_dtheta": 0.03793762996792793,
      "rmse_dx": 0.01802700012922287,
      "rmse_dy": 0.006561934016644955,
      "rmse_mean": 0.020842187106609344,
      "rotation_flip": 0.005763688590377569,
      "sparse_tokens": 7231.0,
      "step": 9579,
      "turn_loss": 0.17633533477783203,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.44508455677383385,
      "grad_norm": 0.7579969167709351,
      "learning_rate": 9.901737509616144e-07,
      "loss": 0.1912,
      "mae_dtheta": 0.040337782353162766,
      "mae_dx": 0.021566811949014664,
      "mae_dy": 0.01079231034964323,
      "pose_mae_dtheta": 0.3034519851207733,
      "pose_mae_dx": 0.1927071511745453,
      "pose_mae_dy": 0.09626732021570206,
      "pose_rmse_dtheta": 0.49986520409584045,
      "pose_rmse_dx": 0.3705032169818878,
      "pose_rmse_dy": 0.21478456258773804,
      "pose_rmse_mean": 0.36171767115592957,
      "rmse_dtheta": 0.056803639978170395,
      "rmse_dx": 0.03503163903951645,
      "rmse_dy": 0.02116747945547104,
      "rmse_mean": 0.03766758739948273,
      "rotation_flip": 0.022494887933135033,
      "sparse_tokens": 8458.0,
      "step": 9580,
      "turn_loss": 0.5153490304946899,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 20775.0,
      "epoch": 0.4451310165396766,
      "grad_norm": 0.6709301471710205,
      "learning_rate": 9.893840362247809e-07,
      "loss": 0.1196,
      "mae_dtheta": 0.025581199675798416,
      "mae_dx": 0.010148704051971436,
      "mae_dy": 0.003693684935569763,
      "pose_mae_dtheta": 0.19535143673419952,
      "pose_mae_dx": 0.07159268110990524,
      "pose_mae_dy": 0.039549779146909714,
      "pose_rmse_dtheta": 0.41550570726394653,
      "pose_rmse_dx": 0.1999722570180893,
      "pose_rmse_dy": 0.12369999289512634,
      "pose_rmse_mean": 0.2463926523923874,
      "rmse_dtheta": 0.047472793608903885,
      "rmse_dx": 0.02357545681297779,
      "rmse_dy": 0.01114776823669672,
      "rmse_mean": 0.027398673817515373,
      "rotation_flip": 0.010430247522890568,
      "sparse_tokens": 16787.0,
      "step": 9581,
      "turn_loss": 0.21089670062065125,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 39790.0,
      "epoch": 0.4451774763055194,
      "grad_norm": 0.5721875429153442,
      "learning_rate": 9.885946019524762e-07,
      "loss": 0.1271,
      "mae_dtheta": 0.03485897183418274,
      "mae_dx": 0.012946047820150852,
      "mae_dy": 0.003702219808474183,
      "pose_mae_dtheta": 0.3008679449558258,
      "pose_mae_dx": 0.1081077829003334,
      "pose_mae_dy": 0.050685539841651917,
      "pose_rmse_dtheta": 0.49031147360801697,
      "pose_rmse_dx": 0.24498185515403748,
      "pose_rmse_dy": 0.1192474365234375,
      "pose_rmse_mean": 0.2848469316959381,
      "rmse_dtheta": 0.05160331726074219,
      "rmse_dx": 0.02641678787767887,
      "rmse_dy": 0.007946370169520378,
      "rmse_mean": 0.028655491769313812,
      "rotation_flip": 0.013171759434044361,
      "sparse_tokens": 29890.0,
      "step": 9582,
      "turn_loss": 0.2788706123828888,
      "turns": 123.0,
      "turns_per_sample": 123.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4452239360713622,
      "grad_norm": 0.33906325697898865,
      "learning_rate": 9.878054481999027e-07,
      "loss": 0.079,
      "mae_dtheta": 0.009978709742426872,
      "mae_dx": 0.0019069392001256347,
      "mae_dy": 0.002714902628213167,
      "pose_mae_dtheta": 0.0699615478515625,
      "pose_mae_dx": 0.02546597272157669,
      "pose_mae_dy": 0.03303300589323044,
      "pose_rmse_dtheta": 0.1434962898492813,
      "pose_rmse_dx": 0.06015409901738167,
      "pose_rmse_dy": 0.07772746682167053,
      "pose_rmse_mean": 0.0937926173210144,
      "rmse_dtheta": 0.01986122690141201,
      "rmse_dx": 0.005871085450053215,
      "rmse_dy": 0.00641588494181633,
      "rmse_mean": 0.010716065764427185,
      "rotation_flip": 0.003407154930755496,
      "sparse_tokens": 32089.0,
      "step": 9583,
      "turn_loss": 0.08949507027864456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.44527039583720496,
      "grad_norm": 0.709884524345398,
      "learning_rate": 9.870165750222487e-07,
      "loss": 0.1577,
      "mae_dtheta": 0.009746843948960304,
      "mae_dx": 0.0013739272253587842,
      "mae_dy": 0.0018888922641053796,
      "pose_mae_dtheta": 0.06921632587909698,
      "pose_mae_dx": 0.015447710640728474,
      "pose_mae_dy": 0.022974008694291115,
      "pose_rmse_dtheta": 0.1792510598897934,
      "pose_rmse_dx": 0.035723112523555756,
      "pose_rmse_dy": 0.048715852200984955,
      "pose_rmse_mean": 0.0878966748714447,
      "rmse_dtheta": 0.02172880433499813,
      "rmse_dx": 0.003782981773838401,
      "rmse_dy": 0.004482118878513575,
      "rmse_mean": 0.009997968561947346,
      "rotation_flip": 0.0073359073139727116,
      "sparse_tokens": 32121.0,
      "step": 9584,
      "turn_loss": 0.07066559046506882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.44531685560304773,
      "grad_norm": 0.5487133264541626,
      "learning_rate": 9.862279824746784e-07,
      "loss": 0.097,
      "mae_dtheta": 0.0064530931413173676,
      "mae_dx": 0.0012167496606707573,
      "mae_dy": 0.0008134435629472136,
      "pose_mae_dtheta": 0.04596681892871857,
      "pose_mae_dx": 0.010942129418253899,
      "pose_mae_dy": 0.013199047185480595,
      "pose_rmse_dtheta": 0.14259065687656403,
      "pose_rmse_dx": 0.030540507286787033,
      "pose_rmse_dy": 0.03930913656949997,
      "pose_rmse_mean": 0.07081343978643417,
      "rmse_dtheta": 0.0206748154014349,
      "rmse_dx": 0.00387306185439229,
      "rmse_dy": 0.0020899400115013123,
      "rmse_mean": 0.008879272267222404,
      "rotation_flip": 0.0006049606599844992,
      "sparse_tokens": 32121.0,
      "step": 9585,
      "turn_loss": 0.04366668686270714,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.44536331536889057,
      "grad_norm": 0.8277180790901184,
      "learning_rate": 9.85439670612341e-07,
      "loss": 0.1661,
      "mae_dtheta": 0.030247922986745834,
      "mae_dx": 0.007363442797213793,
      "mae_dy": 0.008730434812605381,
      "pose_mae_dtheta": 0.21751989424228668,
      "pose_mae_dx": 0.09058301895856857,
      "pose_mae_dy": 0.08226308226585388,
      "pose_rmse_dtheta": 0.3415260314941406,
      "pose_rmse_dx": 0.1892269402742386,
      "pose_rmse_dy": 0.15803727507591248,
      "pose_rmse_mean": 0.22959673404693604,
      "rmse_dtheta": 0.04424689710140228,
      "rmse_dx": 0.015196994878351688,
      "rmse_dy": 0.015975087881088257,
      "rmse_mean": 0.025139659643173218,
      "rotation_flip": 0.009615384973585606,
      "sparse_tokens": 7463.0,
      "step": 9586,
      "turn_loss": 0.23099549114704132,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 4901.0,
      "epoch": 0.44540977513473334,
      "grad_norm": 0.3535226881504059,
      "learning_rate": 9.846516394903604e-07,
      "loss": 0.0813,
      "mae_dtheta": 0.04197953641414642,
      "mae_dx": 0.012143407016992569,
      "mae_dy": 0.00993265025317669,
      "pose_mae_dtheta": 0.378256231546402,
      "pose_mae_dx": 0.07835261523723602,
      "pose_mae_dy": 0.06230732053518295,
      "pose_rmse_dtheta": 0.7163226008415222,
      "pose_rmse_dx": 0.1794462502002716,
      "pose_rmse_dy": 0.16645708680152893,
      "pose_rmse_mean": 0.3540753126144409,
      "rmse_dtheta": 0.06596206873655319,
      "rmse_dx": 0.026824969798326492,
      "rmse_dy": 0.02127511240541935,
      "rmse_mean": 0.03802071884274483,
      "rotation_flip": 0.016597511246800423,
      "sparse_tokens": 4386.0,
      "step": 9587,
      "turn_loss": 0.4044041335582733,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.4454562349005761,
      "grad_norm": 0.4079701006412506,
      "learning_rate": 9.838638891638475e-07,
      "loss": 0.0607,
      "mae_dtheta": 0.008453869260847569,
      "mae_dx": 0.0009983237832784653,
      "mae_dy": 0.0016465799417346716,
      "pose_mae_dtheta": 0.0561518669128418,
      "pose_mae_dx": 0.016364412382245064,
      "pose_mae_dy": 0.0243381317704916,
      "pose_rmse_dtheta": 0.1383436918258667,
      "pose_rmse_dx": 0.05345168337225914,
      "pose_rmse_dy": 0.07085937261581421,
      "pose_rmse_mean": 0.08755158632993698,
      "rmse_dtheta": 0.019140038639307022,
      "rmse_dx": 0.003579826094210148,
      "rmse_dy": 0.003953406121581793,
      "rmse_mean": 0.008891090750694275,
      "rotation_flip": 0.0016137708444148302,
      "sparse_tokens": 32025.0,
      "step": 9588,
      "turn_loss": 0.057874273508787155,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4455026946664189,
      "grad_norm": 0.6907637715339661,
      "learning_rate": 9.830764196878872e-07,
      "loss": 0.1243,
      "mae_dtheta": 0.010543490760028362,
      "mae_dx": 0.001426028786227107,
      "mae_dy": 0.002219019690528512,
      "pose_mae_dtheta": 0.07078886777162552,
      "pose_mae_dx": 0.01888277940452099,
      "pose_mae_dy": 0.02645956724882126,
      "pose_rmse_dtheta": 0.21233153343200684,
      "pose_rmse_dx": 0.05691370368003845,
      "pose_rmse_dy": 0.07544199377298355,
      "pose_rmse_mean": 0.11489574611186981,
      "rmse_dtheta": 0.024950746446847916,
      "rmse_dx": 0.0041546751745045185,
      "rmse_dy": 0.004931424278765917,
      "rmse_mean": 0.011345615610480309,
      "rotation_flip": 0.005912494845688343,
      "sparse_tokens": 32089.0,
      "step": 9589,
      "turn_loss": 0.0812319964170456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.4455491544322617,
      "grad_norm": 0.583727240562439,
      "learning_rate": 9.822892311175497e-07,
      "loss": 0.1259,
      "mae_dtheta": 0.030732175335288048,
      "mae_dx": 0.010481291450560093,
      "mae_dy": 0.005266027990728617,
      "pose_mae_dtheta": 0.23517441749572754,
      "pose_mae_dx": 0.08655411005020142,
      "pose_mae_dy": 0.05896153301000595,
      "pose_rmse_dtheta": 0.38167062401771545,
      "pose_rmse_dx": 0.20235134661197662,
      "pose_rmse_dy": 0.1365308165550232,
      "pose_rmse_mean": 0.24018427729606628,
      "rmse_dtheta": 0.04847366735339165,
      "rmse_dx": 0.02294120006263256,
      "rmse_dy": 0.01129181683063507,
      "rmse_mean": 0.027568895369768143,
      "rotation_flip": 0.0054054055362939835,
      "sparse_tokens": 11238.0,
      "step": 9590,
      "turn_loss": 0.29554349184036255,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.44559561419810445,
      "grad_norm": 0.6871210336685181,
      "learning_rate": 9.81502323507882e-07,
      "loss": 0.136,
      "mae_dtheta": 0.030390962958335876,
      "mae_dx": 0.010510118678212166,
      "mae_dy": 0.002740890718996525,
      "pose_mae_dtheta": 0.24046939611434937,
      "pose_mae_dx": 0.08704002946615219,
      "pose_mae_dy": 0.03177585080265999,
      "pose_rmse_dtheta": 0.49337828159332275,
      "pose_rmse_dx": 0.21497559547424316,
      "pose_rmse_dy": 0.07748093456029892,
      "pose_rmse_mean": 0.2619449496269226,
      "rmse_dtheta": 0.051065828651189804,
      "rmse_dx": 0.023129325360059738,
      "rmse_dy": 0.005841068457812071,
      "rmse_mean": 0.026678740978240967,
      "rotation_flip": 0.01512605044990778,
      "sparse_tokens": 11679.0,
      "step": 9591,
      "turn_loss": 0.21988545358181,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.4456420739639472,
      "grad_norm": 0.9858970642089844,
      "learning_rate": 9.807156969139136e-07,
      "loss": 0.249,
      "mae_dtheta": 0.028210453689098358,
      "mae_dx": 0.012731105089187622,
      "mae_dy": 0.005549754481762648,
      "pose_mae_dtheta": 0.21558798849582672,
      "pose_mae_dx": 0.09102320671081543,
      "pose_mae_dy": 0.06868065893650055,
      "pose_rmse_dtheta": 0.3711673319339752,
      "pose_rmse_dx": 0.21275554597377777,
      "pose_rmse_dy": 0.15395833551883698,
      "pose_rmse_mean": 0.24596039950847626,
      "rmse_dtheta": 0.04127206280827522,
      "rmse_dx": 0.02632787637412548,
      "rmse_dy": 0.009642604738473892,
      "rmse_mean": 0.0257475133985281,
      "rotation_flip": 0.008426966145634651,
      "sparse_tokens": 13409.0,
      "step": 9592,
      "turn_loss": 0.24323293566703796,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.44568853372979,
      "grad_norm": 0.6752197742462158,
      "learning_rate": 9.79929351390655e-07,
      "loss": 0.1506,
      "mae_dtheta": 0.008448556996881962,
      "mae_dx": 0.0014904506970196962,
      "mae_dy": 0.001656636712141335,
      "pose_mae_dtheta": 0.05473700538277626,
      "pose_mae_dx": 0.01550387404859066,
      "pose_mae_dy": 0.017168933525681496,
      "pose_rmse_dtheta": 0.1651608794927597,
      "pose_rmse_dx": 0.03519482910633087,
      "pose_rmse_dy": 0.04582403227686882,
      "pose_rmse_mean": 0.08205991983413696,
      "rmse_dtheta": 0.022827137261629105,
      "rmse_dx": 0.0038849455304443836,
      "rmse_dy": 0.004272017162293196,
      "rmse_mean": 0.010328033939003944,
      "rotation_flip": 0.0034722222480922937,
      "sparse_tokens": 32217.0,
      "step": 9593,
      "turn_loss": 0.06266552209854126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.4457349934956328,
      "grad_norm": 0.6645830273628235,
      "learning_rate": 9.791432869930927e-07,
      "loss": 0.1116,
      "mae_dtheta": 0.03323441743850708,
      "mae_dx": 0.013776990585029125,
      "mae_dy": 0.013530577532947063,
      "pose_mae_dtheta": 0.23474198579788208,
      "pose_mae_dx": 0.10650797188282013,
      "pose_mae_dy": 0.15128470957279205,
      "pose_rmse_dtheta": 0.38225239515304565,
      "pose_rmse_dx": 0.24007104337215424,
      "pose_rmse_dy": 0.337209016084671,
      "pose_rmse_mean": 0.31984418630599976,
      "rmse_dtheta": 0.049074601382017136,
      "rmse_dx": 0.025943249464035034,
      "rmse_dy": 0.02585764415562153,
      "rmse_mean": 0.03362516686320305,
      "rotation_flip": 0.016470588743686676,
      "sparse_tokens": 7418.0,
      "step": 9594,
      "turn_loss": 0.37453973293304443,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.44578145326147556,
      "grad_norm": 0.3901591897010803,
      "learning_rate": 9.783575037762006e-07,
      "loss": 0.1295,
      "mae_dtheta": 0.008002649061381817,
      "mae_dx": 0.001628234633244574,
      "mae_dy": 0.002357516437768936,
      "pose_mae_dtheta": 0.04978293925523758,
      "pose_mae_dx": 0.019834112375974655,
      "pose_mae_dy": 0.019805610179901123,
      "pose_rmse_dtheta": 0.10747838020324707,
      "pose_rmse_dx": 0.049229785799980164,
      "pose_rmse_dy": 0.04158665984869003,
      "pose_rmse_mean": 0.06609827280044556,
      "rmse_dtheta": 0.016851404681801796,
      "rmse_dx": 0.004808150697499514,
      "rmse_dy": 0.005006764084100723,
      "rmse_mean": 0.008888773620128632,
      "rotation_flip": 0.003971118945628405,
      "sparse_tokens": 32105.0,
      "step": 9595,
      "turn_loss": 0.07074412703514099,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.44582791302731833,
      "grad_norm": 0.5840630531311035,
      "learning_rate": 9.775720017949253e-07,
      "loss": 0.0803,
      "mae_dtheta": 0.010903635062277317,
      "mae_dx": 0.0022557033225893974,
      "mae_dy": 0.0022386640775948763,
      "pose_mae_dtheta": 0.07325178384780884,
      "pose_mae_dx": 0.02342803031206131,
      "pose_mae_dy": 0.025805659592151642,
      "pose_rmse_dtheta": 0.16698269546031952,
      "pose_rmse_dx": 0.05780046060681343,
      "pose_rmse_dy": 0.06010183319449425,
      "pose_rmse_mean": 0.09496166557073593,
      "rmse_dtheta": 0.022665617987513542,
      "rmse_dx": 0.006475938018411398,
      "rmse_dy": 0.004657309036701918,
      "rmse_mean": 0.01126628927886486,
      "rotation_flip": 0.004071937408298254,
      "sparse_tokens": 32201.0,
      "step": 9596,
      "turn_loss": 0.09239130467176437,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.4458743727931611,
      "grad_norm": 0.6089518070220947,
      "learning_rate": 9.767867811041998e-07,
      "loss": 0.1167,
      "mae_dtheta": 0.031310223042964935,
      "mae_dx": 0.009911640547215939,
      "mae_dy": 0.004113559145480394,
      "pose_mae_dtheta": 0.25393471121788025,
      "pose_mae_dx": 0.08931955695152283,
      "pose_mae_dy": 0.07006946951150894,
      "pose_rmse_dtheta": 0.5163652300834656,
      "pose_rmse_dx": 0.24401047825813293,
      "pose_rmse_dy": 0.14381036162376404,
      "pose_rmse_mean": 0.30139538645744324,
      "rmse_dtheta": 0.053105633705854416,
      "rmse_dx": 0.02451278455555439,
      "rmse_dy": 0.008148628287017345,
      "rmse_mean": 0.02858901582658291,
      "rotation_flip": 0.017721518874168396,
      "sparse_tokens": 8771.0,
      "step": 9597,
      "turn_loss": 0.20437991619110107,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 28139.0,
      "epoch": 0.4459208325590039,
      "grad_norm": 0.8974707722663879,
      "learning_rate": 9.760018417589333e-07,
      "loss": 0.2638,
      "mae_dtheta": 0.03615458309650421,
      "mae_dx": 0.015912190079689026,
      "mae_dy": 0.005318536423146725,
      "pose_mae_dtheta": 0.3088742196559906,
      "pose_mae_dx": 0.13106153905391693,
      "pose_mae_dy": 0.08058509230613708,
      "pose_rmse_dtheta": 0.5245668292045593,
      "pose_rmse_dx": 0.27597472071647644,
      "pose_rmse_dy": 0.19314904510974884,
      "pose_rmse_mean": 0.33123019337654114,
      "rmse_dtheta": 0.053620029240846634,
      "rmse_dx": 0.029862483963370323,
      "rmse_dy": 0.010045056231319904,
      "rmse_mean": 0.031175857409834862,
      "rotation_flip": 0.00803212821483612,
      "sparse_tokens": 20473.0,
      "step": 9598,
      "turn_loss": 0.28464317321777344,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.44596729232484666,
      "grad_norm": 0.8218936920166016,
      "learning_rate": 9.752171838140173e-07,
      "loss": 0.2353,
      "mae_dtheta": 0.02797694504261017,
      "mae_dx": 0.01115577481687069,
      "mae_dy": 0.005037141032516956,
      "pose_mae_dtheta": 0.2159242480993271,
      "pose_mae_dx": 0.0969708040356636,
      "pose_mae_dy": 0.05885493755340576,
      "pose_rmse_dtheta": 0.37410709261894226,
      "pose_rmse_dx": 0.2112945020198822,
      "pose_rmse_dy": 0.11955992132425308,
      "pose_rmse_mean": 0.23498718440532684,
      "rmse_dtheta": 0.042547568678855896,
      "rmse_dx": 0.023116430267691612,
      "rmse_dy": 0.00981156900525093,
      "rmse_mean": 0.02515852451324463,
      "rotation_flip": 0.017770597711205482,
      "sparse_tokens": 11124.0,
      "step": 9599,
      "turn_loss": 0.184621199965477,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.44601375209068944,
      "grad_norm": 0.6132610440254211,
      "learning_rate": 9.744328073243258e-07,
      "loss": 0.1485,
      "mae_dtheta": 0.011043415404856205,
      "mae_dx": 0.0015416438691318035,
      "mae_dy": 0.0029069276060909033,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6132610440254211,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.7408905029297,
      "model/head/act_norm_mean": 100.78989109848484,
      "model/head/act_norm_min": 60.160518646240234,
      "model/head/act_over_embed": 69.26375677270606,
      "model/head/grad_frac": 0.12221316248178482,
      "model/head/grad_norm": 0.07494857162237167,
      "model/head/grad_zero_frac": 0.000174182205228135,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7123332938762627,
      "model/head/update_ratio": 0.0012760494137182832,
      "model/head/weight_delta": 9.921614646911621,
      "model/head/weight_delta_rel": 0.17405450344085693,
      "model/head/weight_norm": 58.7348518371582,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4227704405784607,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42269092716582835,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226214587688446,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29047716244316557,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05295077711343765,
      "model/modality_embedder.encoders.pose/grad_norm": 0.0324726477265358,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5407034817351598,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010485410457476974,
      "model/modality_embedder.encoders.pose/weight_delta": 3.141512393951416,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10264299809932709,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969364166259766,
      "model/modality_embedder/grad_frac": 0.05295077711343765,
      "model/modality_embedder/grad_norm": 0.0324726477265358,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5407034817351598,
      "model/modality_embedder/update_ratio": 0.0010485410457476974,
      "model/modality_embedder/weight_delta": 3.141512393951416,
      "model/modality_embedder/weight_delta_rel": 0.10264299809932709,
      "model/modality_embedder/weight_norm": 30.969364166259766,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.31417846679688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.735845558762225,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.13122272491455,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.624285924321129,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.13639773428440094,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.08364741504192352,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0029923757538199425,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.708096981048584,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09868469089269638,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95351219177246,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.85345458984375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.671890031265033,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.318587303161621,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.267544449211478,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.11684061586856842,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07165379822254181,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0024078423157334328,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4339301586151123,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11895402520895004,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.75851058959961,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.0025863647461,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.51732854337021,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.553930282592773,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.535747071997715,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.11658572405576706,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07149748504161835,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00232671364210546,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7178595066070557,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12483876198530197,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.72895622253418,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.85753631591797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.309912117203783,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.383709907531738,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.767627286367976,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11035174876451492,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0676744282245636,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022599436342716217,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1932482719421387,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10913006961345673,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9451847076416,
      "model/normalizer/grad_frac": 0.47358056902885437,
      "model/normalizer/grad_norm": 0.2904285192489624,
      "model/normalizer/grad_zero_frac": 0.00018907814228441566,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0036929515190422535,
      "model/normalizer/weight_delta": 6.721285343170166,
      "model/normalizer/weight_delta_rel": 0.086566261947155,
      "model/normalizer/weight_norm": 78.64401245117188,
      "pose_mae_dtheta": 0.06922172755002975,
      "pose_mae_dx": 0.023421568796038628,
      "pose_mae_dy": 0.03092852234840393,
      "pose_rmse_dtheta": 0.15892009437084198,
      "pose_rmse_dx": 0.06312219053506851,
      "pose_rmse_dy": 0.06730150431394577,
      "pose_rmse_mean": 0.09644793719053268,
      "rmse_dtheta": 0.02225128561258316,
      "rmse_dx": 0.004610513802617788,
      "rmse_dy": 0.006149196531623602,
      "rmse_mean": 0.011003665626049042,
      "rotation_flip": 0.007254261989146471,
      "sparse_tokens": 32073.0,
      "step": 9600,
      "turn_loss": 0.09341010451316833,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.44601375209068944,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3009582459926605,
      "eval_objectnav_nopose_mae_dtheta": 0.03944633528590202,
      "eval_objectnav_nopose_mae_dx": 0.012797549366950989,
      "eval_objectnav_nopose_mae_dy": 0.004929874558001757,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3162751793861389,
      "eval_objectnav_nopose_pose_mae_dx": 0.10086172074079514,
      "eval_objectnav_nopose_pose_mae_dy": 0.05330197885632515,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5375298261642456,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22490839660167694,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12782807648181915,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29675543308258057,
      "eval_objectnav_nopose_rmse_dtheta": 0.057331740856170654,
      "eval_objectnav_nopose_rmse_dx": 0.025299392640590668,
      "eval_objectnav_nopose_rmse_dy": 0.01033883634954691,
      "eval_objectnav_nopose_rmse_mean": 0.030989989638328552,
      "eval_objectnav_nopose_rotation_flip": 0.015727080404758453,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3009582459926605,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 9600
    },
    {
      "epoch": 0.44601375209068944,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.26868292689323425,
      "eval_objectnav_pose_mae_dtheta": 0.03434110805392265,
      "eval_objectnav_pose_mae_dx": 0.010716847144067287,
      "eval_objectnav_pose_mae_dy": 0.004663417115807533,
      "eval_objectnav_pose_pose_mae_dtheta": 0.25915780663490295,
      "eval_objectnav_pose_pose_mae_dx": 0.08392423391342163,
      "eval_objectnav_pose_pose_mae_dy": 0.047664377838373184,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45697540044784546,
      "eval_objectnav_pose_pose_rmse_dx": 0.1954781711101532,
      "eval_objectnav_pose_pose_rmse_dy": 0.11538402736186981,
      "eval_objectnav_pose_pose_rmse_mean": 0.2559458613395691,
      "eval_objectnav_pose_rmse_dtheta": 0.05186853185296059,
      "eval_objectnav_pose_rmse_dx": 0.022518156096339226,
      "eval_objectnav_pose_rmse_dy": 0.009855274111032486,
      "eval_objectnav_pose_rmse_mean": 0.02808065339922905,
      "eval_objectnav_pose_rotation_flip": 0.015962662175297737,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.26868292689323425,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 9600
    },
    {
      "epoch": 0.44601375209068944,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08820896595716476,
      "eval_pointnav_mae_dtheta": 0.009870346635580063,
      "eval_pointnav_mae_dx": 0.0022639792878180742,
      "eval_pointnav_mae_dy": 0.0022797558922320604,
      "eval_pointnav_pose_mae_dtheta": 0.06751758605241776,
      "eval_pointnav_pose_mae_dx": 0.024833988398313522,
      "eval_pointnav_pose_mae_dy": 0.02418421022593975,
      "eval_pointnav_pose_rmse_dtheta": 0.1968744695186615,
      "eval_pointnav_pose_rmse_dx": 0.07972455769777298,
      "eval_pointnav_pose_rmse_dy": 0.06915584206581116,
      "eval_pointnav_pose_rmse_mean": 0.11525162309408188,
      "eval_pointnav_rmse_dtheta": 0.024808166548609734,
      "eval_pointnav_rmse_dx": 0.007465745322406292,
      "eval_pointnav_rmse_dy": 0.006215812638401985,
      "eval_pointnav_rmse_mean": 0.012829907238483429,
      "eval_pointnav_rotation_flip": 0.00499729672446847,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08820896595716476,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 9600
    },
    {
      "epoch": 0.44601375209068944,
      "eval_loss": 0.21928337961435318,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3009582459926605,
      "eval_objectnav_nopose_mae_dtheta": 0.03944633528590202,
      "eval_objectnav_nopose_mae_dx": 0.012797549366950989,
      "eval_objectnav_nopose_mae_dy": 0.004929874558001757,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3162751793861389,
      "eval_objectnav_nopose_pose_mae_dx": 0.10086172074079514,
      "eval_objectnav_nopose_pose_mae_dy": 0.05330197885632515,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5375298261642456,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22490839660167694,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12782807648181915,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29675543308258057,
      "eval_objectnav_nopose_rmse_dtheta": 0.057331740856170654,
      "eval_objectnav_nopose_rmse_dx": 0.025299392640590668,
      "eval_objectnav_nopose_rmse_dy": 0.01033883634954691,
      "eval_objectnav_nopose_rmse_mean": 0.030989989638328552,
      "eval_objectnav_nopose_rotation_flip": 0.015727080404758453,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3009582459926605,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.26868292689323425,
      "eval_objectnav_pose_mae_dtheta": 0.03434110805392265,
      "eval_objectnav_pose_mae_dx": 0.010716847144067287,
      "eval_objectnav_pose_mae_dy": 0.004663417115807533,
      "eval_objectnav_pose_pose_mae_dtheta": 0.25915780663490295,
      "eval_objectnav_pose_pose_mae_dx": 0.08392423391342163,
      "eval_objectnav_pose_pose_mae_dy": 0.047664377838373184,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45697540044784546,
      "eval_objectnav_pose_pose_rmse_dx": 0.1954781711101532,
      "eval_objectnav_pose_pose_rmse_dy": 0.11538402736186981,
      "eval_objectnav_pose_pose_rmse_mean": 0.2559458613395691,
      "eval_objectnav_pose_rmse_dtheta": 0.05186853185296059,
      "eval_objectnav_pose_rmse_dx": 0.022518156096339226,
      "eval_objectnav_pose_rmse_dy": 0.009855274111032486,
      "eval_objectnav_pose_rmse_mean": 0.02808065339922905,
      "eval_objectnav_pose_rotation_flip": 0.015962662175297737,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.26868292689323425,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08820896595716476,
      "eval_pointnav_mae_dtheta": 0.009870346635580063,
      "eval_pointnav_mae_dx": 0.0022639792878180742,
      "eval_pointnav_mae_dy": 0.0022797558922320604,
      "eval_pointnav_pose_mae_dtheta": 0.06751758605241776,
      "eval_pointnav_pose_mae_dx": 0.024833988398313522,
      "eval_pointnav_pose_mae_dy": 0.02418421022593975,
      "eval_pointnav_pose_rmse_dtheta": 0.1968744695186615,
      "eval_pointnav_pose_rmse_dx": 0.07972455769777298,
      "eval_pointnav_pose_rmse_dy": 0.06915584206581116,
      "eval_pointnav_pose_rmse_mean": 0.11525162309408188,
      "eval_pointnav_rmse_dtheta": 0.024808166548609734,
      "eval_pointnav_rmse_dx": 0.007465745322406292,
      "eval_pointnav_rmse_dy": 0.006215812638401985,
      "eval_pointnav_rmse_mean": 0.012829907238483429,
      "eval_pointnav_rotation_flip": 0.00499729672446847,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08820896595716476,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 9600
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.4460602118565322,
      "grad_norm": 0.4261876046657562,
      "learning_rate": 9.73648712344707e-07,
      "loss": 0.0835,
      "mae_dtheta": 0.007303318474441767,
      "mae_dx": 0.0014491708716377616,
      "mae_dy": 0.00044746536877937615,
      "pose_mae_dtheta": 0.04820425435900688,
      "pose_mae_dx": 0.012082763016223907,
      "pose_mae_dy": 0.00565196992829442,
      "pose_rmse_dtheta": 0.2009546309709549,
      "pose_rmse_dx": 0.028667885810136795,
      "pose_rmse_dy": 0.02304394729435444,
      "pose_rmse_mean": 0.08422216027975082,
      "rmse_dtheta": 0.02654736489057541,
      "rmse_dx": 0.003842840204015374,
      "rmse_dy": 0.0016526887193322182,
      "rmse_mean": 0.010680965147912502,
      "rotation_flip": 0.0022197559010237455,
      "sparse_tokens": 32233.0,
      "step": 9601,
      "turn_loss": 0.047126155346632004,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.44610667162237505,
      "grad_norm": 0.49896153807640076,
      "learning_rate": 9.72864898929996e-07,
      "loss": 0.1217,
      "mae_dtheta": 0.012157217599451542,
      "mae_dx": 0.0016528021078556776,
      "mae_dy": 0.0034585357643663883,
      "pose_mae_dtheta": 0.0761570855975151,
      "pose_mae_dx": 0.023026028648018837,
      "pose_mae_dy": 0.03594083711504936,
      "pose_rmse_dtheta": 0.1651882827281952,
      "pose_rmse_dx": 0.05347185209393501,
      "pose_rmse_dy": 0.08136256039142609,
      "pose_rmse_mean": 0.100007563829422,
      "rmse_dtheta": 0.023616112768650055,
      "rmse_dx": 0.005202082917094231,
      "rmse_dy": 0.00795728899538517,
      "rmse_mean": 0.012258495204150677,
      "rotation_flip": 0.006451612804085016,
      "sparse_tokens": 32089.0,
      "step": 9602,
      "turn_loss": 0.11063674837350845,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4461531313882178,
      "grad_norm": 0.5691797137260437,
      "learning_rate": 9.720813671350033e-07,
      "loss": 0.0946,
      "mae_dtheta": 0.0032916362397372723,
      "mae_dx": 0.001871524378657341,
      "mae_dy": 0.00027756651979871094,
      "pose_mae_dtheta": 0.022044453769922256,
      "pose_mae_dx": 0.013988482765853405,
      "pose_mae_dy": 0.003896817099303007,
      "pose_rmse_dtheta": 0.11172527819871902,
      "pose_rmse_dx": 0.06654812395572662,
      "pose_rmse_dy": 0.009797876700758934,
      "pose_rmse_mean": 0.06269042938947678,
      "rmse_dtheta": 0.014775879681110382,
      "rmse_dx": 0.007918099872767925,
      "rmse_dy": 0.000766354554798454,
      "rmse_mean": 0.007820111699402332,
      "rotation_flip": 0.0018281536176800728,
      "sparse_tokens": 32057.0,
      "step": 9603,
      "turn_loss": 0.029655717313289642,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.4461995911540606,
      "grad_norm": 0.9678911566734314,
      "learning_rate": 9.712981170145236e-07,
      "loss": 0.2993,
      "mae_dtheta": 0.017500851303339005,
      "mae_dx": 0.005862825084477663,
      "mae_dy": 0.005600622855126858,
      "pose_mae_dtheta": 0.10841148346662521,
      "pose_mae_dx": 0.05881304666399956,
      "pose_mae_dy": 0.07344134151935577,
      "pose_rmse_dtheta": 0.17254813015460968,
      "pose_rmse_dx": 0.14590798318386078,
      "pose_rmse_dy": 0.1290106177330017,
      "pose_rmse_mean": 0.14915558695793152,
      "rmse_dtheta": 0.02642008475959301,
      "rmse_dx": 0.014579576440155506,
      "rmse_dy": 0.00849819928407669,
      "rmse_mean": 0.016499288380146027,
      "rotation_flip": 0.014705882407724857,
      "sparse_tokens": 4023.0,
      "step": 9604,
      "turn_loss": 0.13362236320972443,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.4462460509199034,
      "grad_norm": 0.6282742023468018,
      "learning_rate": 9.705151486233277e-07,
      "loss": 0.1,
      "mae_dtheta": 0.02210812270641327,
      "mae_dx": 0.011452874168753624,
      "mae_dy": 0.002745779464021325,
      "pose_mae_dtheta": 0.1567152440547943,
      "pose_mae_dx": 0.08403672277927399,
      "pose_mae_dy": 0.035279419273138046,
      "pose_rmse_dtheta": 0.3377291262149811,
      "pose_rmse_dx": 0.21344955265522003,
      "pose_rmse_dy": 0.09654378145933151,
      "pose_rmse_mean": 0.2159074991941452,
      "rmse_dtheta": 0.03826683759689331,
      "rmse_dx": 0.02448597364127636,
      "rmse_dy": 0.006257005967199802,
      "rmse_mean": 0.023003272712230682,
      "rotation_flip": 0.003636363660916686,
      "sparse_tokens": 9897.0,
      "step": 9605,
      "turn_loss": 0.16708029806613922,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.44629251068574616,
      "grad_norm": 0.5006476640701294,
      "learning_rate": 9.697324620161703e-07,
      "loss": 0.1078,
      "mae_dtheta": 0.03380945324897766,
      "mae_dx": 0.011637572199106216,
      "mae_dy": 0.007633775472640991,
      "pose_mae_dtheta": 0.24448247253894806,
      "pose_mae_dx": 0.11314305663108826,
      "pose_mae_dy": 0.10011987388134003,
      "pose_rmse_dtheta": 0.37713196873664856,
      "pose_rmse_dx": 0.23627027869224548,
      "pose_rmse_dy": 0.18614378571510315,
      "pose_rmse_mean": 0.2665153443813324,
      "rmse_dtheta": 0.04576744884252548,
      "rmse_dx": 0.02455826662480831,
      "rmse_dy": 0.0126132657751441,
      "rmse_mean": 0.027646329253911972,
      "rotation_flip": 0.004379562102258205,
      "sparse_tokens": 12025.0,
      "step": 9606,
      "turn_loss": 0.30093201994895935,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.44633897045158893,
      "grad_norm": 0.49578189849853516,
      "learning_rate": 9.689500572477857e-07,
      "loss": 0.1109,
      "mae_dtheta": 0.02244267612695694,
      "mae_dx": 0.011800125241279602,
      "mae_dy": 0.0034128911793231964,
      "pose_mae_dtheta": 0.16882827877998352,
      "pose_mae_dx": 0.10156157612800598,
      "pose_mae_dy": 0.04488063603639603,
      "pose_rmse_dtheta": 0.3077733814716339,
      "pose_rmse_dx": 0.25642016530036926,
      "pose_rmse_dy": 0.12057482451200485,
      "pose_rmse_mean": 0.22825613617897034,
      "rmse_dtheta": 0.037122633308172226,
      "rmse_dx": 0.02553090639412403,
      "rmse_dy": 0.00861078780144453,
      "rmse_mean": 0.023754775524139404,
      "rotation_flip": 0.0,
      "sparse_tokens": 10355.0,
      "step": 9607,
      "turn_loss": 0.17909927666187286,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4463854302174317,
      "grad_norm": 0.46475881338119507,
      "learning_rate": 9.681679343728862e-07,
      "loss": 0.09,
      "mae_dtheta": 0.009332161396741867,
      "mae_dx": 0.0012810983462259173,
      "mae_dy": 0.001821571378968656,
      "pose_mae_dtheta": 0.06706564873456955,
      "pose_mae_dx": 0.0167634729295969,
      "pose_mae_dy": 0.019060611724853516,
      "pose_rmse_dtheta": 0.2057165950536728,
      "pose_rmse_dx": 0.059530824422836304,
      "pose_rmse_dy": 0.050061993300914764,
      "pose_rmse_mean": 0.10510313510894775,
      "rmse_dtheta": 0.024887818843126297,
      "rmse_dx": 0.003906117519363761,
      "rmse_dy": 0.00551657285541296,
      "rmse_mean": 0.011436836794018745,
      "rotation_flip": 0.004093328025192022,
      "sparse_tokens": 32121.0,
      "step": 9608,
      "turn_loss": 0.07641248404979706,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.4464318899832745,
      "grad_norm": 0.7125061750411987,
      "learning_rate": 9.673860934461688e-07,
      "loss": 0.1088,
      "mae_dtheta": 0.005983839742839336,
      "mae_dx": 0.0012961637694388628,
      "mae_dy": 0.00020007934654131532,
      "pose_mae_dtheta": 0.0413186177611351,
      "pose_mae_dx": 0.010419530794024467,
      "pose_mae_dy": 0.0026771235279738903,
      "pose_rmse_dtheta": 0.20177344977855682,
      "pose_rmse_dx": 0.023273102939128876,
      "pose_rmse_dy": 0.004936308600008488,
      "pose_rmse_mean": 0.07666095346212387,
      "rmse_dtheta": 0.024334274232387543,
      "rmse_dx": 0.0035111710894852877,
      "rmse_dy": 0.0003722595574799925,
      "rmse_mean": 0.009405901655554771,
      "rotation_flip": 0.0010405827779322863,
      "sparse_tokens": 32265.0,
      "step": 9609,
      "turn_loss": 0.039043061435222626,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.44647834974911726,
      "grad_norm": 0.341168075799942,
      "learning_rate": 9.666045345223046e-07,
      "loss": 0.0872,
      "mae_dtheta": 0.008485887199640274,
      "mae_dx": 0.0013606753200292587,
      "mae_dy": 0.0020807823166251183,
      "pose_mae_dtheta": 0.057177748531103134,
      "pose_mae_dx": 0.01750829815864563,
      "pose_mae_dy": 0.025863243266940117,
      "pose_rmse_dtheta": 0.1298557072877884,
      "pose_rmse_dx": 0.04387372359633446,
      "pose_rmse_dy": 0.06567011028528214,
      "pose_rmse_mean": 0.07979985326528549,
      "rmse_dtheta": 0.018388543277978897,
      "rmse_dx": 0.004631677642464638,
      "rmse_dy": 0.00548706017434597,
      "rmse_mean": 0.009502427652478218,
      "rotation_flip": 0.0025010420940816402,
      "sparse_tokens": 32073.0,
      "step": 9610,
      "turn_loss": 0.08263439685106277,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31790.0,
      "epoch": 0.44652480951496004,
      "grad_norm": 0.702608585357666,
      "learning_rate": 9.6582325765595e-07,
      "loss": 0.1629,
      "mae_dtheta": 0.03978779911994934,
      "mae_dx": 0.007998461835086346,
      "mae_dy": 0.0033251135610044003,
      "pose_mae_dtheta": 0.345605731010437,
      "pose_mae_dx": 0.06442268937826157,
      "pose_mae_dy": 0.03514217585325241,
      "pose_rmse_dtheta": 0.558042585849762,
      "pose_rmse_dx": 0.14782625436782837,
      "pose_rmse_dy": 0.09350045770406723,
      "pose_rmse_mean": 0.2664564251899719,
      "rmse_dtheta": 0.058395713567733765,
      "rmse_dx": 0.017423078417778015,
      "rmse_dy": 0.007978033274412155,
      "rmse_mean": 0.02793227694928646,
      "rotation_flip": 0.018046049401164055,
      "sparse_tokens": 22882.0,
      "step": 9611,
      "turn_loss": 0.28533363342285156,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4465712692808028,
      "grad_norm": 0.4467211067676544,
      "learning_rate": 9.65042262901742e-07,
      "loss": 0.0626,
      "mae_dtheta": 0.005476081743836403,
      "mae_dx": 0.0011722164927050471,
      "mae_dy": 0.00022822624305263162,
      "pose_mae_dtheta": 0.04336938634514809,
      "pose_mae_dx": 0.007765739690512419,
      "pose_mae_dy": 0.0034415603149682283,
      "pose_rmse_dtheta": 0.217448428273201,
      "pose_rmse_dx": 0.018344290554523468,
      "pose_rmse_dy": 0.011793602257966995,
      "pose_rmse_mean": 0.08252877742052078,
      "rmse_dtheta": 0.02309926599264145,
      "rmse_dx": 0.0035412099678069353,
      "rmse_dy": 0.0005592952365987003,
      "rmse_mean": 0.009066591039299965,
      "rotation_flip": 0.0013633265625685453,
      "sparse_tokens": 32201.0,
      "step": 9612,
      "turn_loss": 0.04083867371082306,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.4466177290466456,
      "grad_norm": 0.33585336804389954,
      "learning_rate": 9.642615503142927e-07,
      "loss": 0.0804,
      "mae_dtheta": 0.031280338764190674,
      "mae_dx": 0.010174734517931938,
      "mae_dy": 0.004875808022916317,
      "pose_mae_dtheta": 0.2353113442659378,
      "pose_mae_dx": 0.08914417773485184,
      "pose_mae_dy": 0.044080864638090134,
      "pose_rmse_dtheta": 0.4091555178165436,
      "pose_rmse_dx": 0.19264598190784454,
      "pose_rmse_dy": 0.09429407864809036,
      "pose_rmse_mean": 0.23203186690807343,
      "rmse_dtheta": 0.04722030460834503,
      "rmse_dx": 0.021304652094841003,
      "rmse_dy": 0.009768445044755936,
      "rmse_mean": 0.026097800582647324,
      "rotation_flip": 0.012624585069715977,
      "sparse_tokens": 23993.0,
      "step": 9613,
      "turn_loss": 0.26063600182533264,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.44666418881248837,
      "grad_norm": 0.7426268458366394,
      "learning_rate": 9.634811199482008e-07,
      "loss": 0.1152,
      "mae_dtheta": 0.006030166056007147,
      "mae_dx": 0.001309619634412229,
      "mae_dy": 0.0010445023654028773,
      "pose_mae_dtheta": 0.03868628665804863,
      "pose_mae_dx": 0.01382516510784626,
      "pose_mae_dy": 0.014343569986522198,
      "pose_rmse_dtheta": 0.11244919896125793,
      "pose_rmse_dx": 0.04095102474093437,
      "pose_rmse_dy": 0.03605535626411438,
      "pose_rmse_mean": 0.06315186619758606,
      "rmse_dtheta": 0.015574485994875431,
      "rmse_dx": 0.004970308393239975,
      "rmse_dy": 0.0024352306500077248,
      "rmse_mean": 0.007660008035600185,
      "rotation_flip": 0.006201550364494324,
      "sparse_tokens": 32105.0,
      "step": 9614,
      "turn_loss": 0.05077753961086273,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.44671064857833115,
      "grad_norm": 0.33249083161354065,
      "learning_rate": 9.627009718580394e-07,
      "loss": 0.0823,
      "mae_dtheta": 0.007545471657067537,
      "mae_dx": 0.0016544961836189032,
      "mae_dy": 0.0014181006699800491,
      "pose_mae_dtheta": 0.049521930515766144,
      "pose_mae_dx": 0.015045966021716595,
      "pose_mae_dy": 0.01958693191409111,
      "pose_rmse_dtheta": 0.12087223678827286,
      "pose_rmse_dx": 0.04648361727595329,
      "pose_rmse_dy": 0.046441152691841125,
      "pose_rmse_mean": 0.07126566767692566,
      "rmse_dtheta": 0.01803194358944893,
      "rmse_dx": 0.006168063264340162,
      "rmse_dy": 0.0030838712118566036,
      "rmse_mean": 0.009094626642763615,
      "rotation_flip": 0.002254283055663109,
      "sparse_tokens": 32121.0,
      "step": 9615,
      "turn_loss": 0.06582092493772507,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4467571083441739,
      "grad_norm": 0.6813262104988098,
      "learning_rate": 9.619211060983674e-07,
      "loss": 0.0987,
      "mae_dtheta": 0.01355951651930809,
      "mae_dx": 0.003022453747689724,
      "mae_dy": 0.0032447564881294966,
      "pose_mae_dtheta": 0.09904901683330536,
      "pose_mae_dx": 0.03694215044379234,
      "pose_mae_dy": 0.037574220448732376,
      "pose_rmse_dtheta": 0.21191665530204773,
      "pose_rmse_dx": 0.10342983901500702,
      "pose_rmse_dy": 0.09627549350261688,
      "pose_rmse_mean": 0.13720732927322388,
      "rmse_dtheta": 0.026816489174962044,
      "rmse_dx": 0.00907255057245493,
      "rmse_dy": 0.00790639128535986,
      "rmse_mean": 0.014598477631807327,
      "rotation_flip": 0.006663890089839697,
      "sparse_tokens": 32073.0,
      "step": 9616,
      "turn_loss": 0.12889091670513153,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.4468035681100167,
      "grad_norm": 0.6191136837005615,
      "learning_rate": 9.611415227237181e-07,
      "loss": 0.1478,
      "mae_dtheta": 0.024345912039279938,
      "mae_dx": 0.006398823112249374,
      "mae_dy": 0.00315192062407732,
      "pose_mae_dtheta": 0.17558735609054565,
      "pose_mae_dx": 0.04635845869779587,
      "pose_mae_dy": 0.03998010233044624,
      "pose_rmse_dtheta": 0.34874632954597473,
      "pose_rmse_dx": 0.10281592607498169,
      "pose_rmse_dy": 0.10331859439611435,
      "pose_rmse_mean": 0.1849602907896042,
      "rmse_dtheta": 0.04394244775176048,
      "rmse_dx": 0.016071053221821785,
      "rmse_dy": 0.006454632617533207,
      "rmse_mean": 0.022156044840812683,
      "rotation_flip": 0.018543045967817307,
      "sparse_tokens": 12926.0,
      "step": 9617,
      "turn_loss": 0.16073718667030334,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 33310.0,
      "epoch": 0.4468500278758595,
      "grad_norm": 0.7494543194770813,
      "learning_rate": 9.603622217886116e-07,
      "loss": 0.1311,
      "mae_dtheta": 0.034289199858903885,
      "mae_dx": 0.010814898647367954,
      "mae_dy": 0.004172509536147118,
      "pose_mae_dtheta": 0.2839057147502899,
      "pose_mae_dx": 0.07948955148458481,
      "pose_mae_dy": 0.04331812262535095,
      "pose_rmse_dtheta": 0.5235171914100647,
      "pose_rmse_dx": 0.20671936869621277,
      "pose_rmse_dy": 0.09717944264411926,
      "pose_rmse_mean": 0.2758053243160248,
      "rmse_dtheta": 0.053713224828243256,
      "rmse_dx": 0.023140083998441696,
      "rmse_dy": 0.009145699441432953,
      "rmse_mean": 0.028666336089372635,
      "rotation_flip": 0.01344430260360241,
      "sparse_tokens": 28438.0,
      "step": 9618,
      "turn_loss": 0.21586884558200836,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.4468964876417023,
      "grad_norm": 0.43543872237205505,
      "learning_rate": 9.595832033475417e-07,
      "loss": 0.1392,
      "mae_dtheta": 0.05153635889291763,
      "mae_dx": 0.004570739343762398,
      "mae_dy": 0.0013029894325882196,
      "pose_mae_dtheta": 0.4336945116519928,
      "pose_mae_dx": 0.03292439132928848,
      "pose_mae_dy": 0.009262235835194588,
      "pose_rmse_dtheta": 0.8026113510131836,
      "pose_rmse_dx": 0.07148470729589462,
      "pose_rmse_dy": 0.020201178267598152,
      "pose_rmse_mean": 0.2980991005897522,
      "rmse_dtheta": 0.07600419223308563,
      "rmse_dx": 0.010181033983826637,
      "rmse_dy": 0.003226457629352808,
      "rmse_mean": 0.029803894460201263,
      "rotation_flip": 0.0030487803742289543,
      "sparse_tokens": 5032.0,
      "step": 9619,
      "turn_loss": 0.2664073705673218,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4469429474075451,
      "grad_norm": 0.5303225517272949,
      "learning_rate": 9.588044674549878e-07,
      "loss": 0.1011,
      "mae_dtheta": 0.010743508115410805,
      "mae_dx": 0.0014891159953549504,
      "mae_dy": 0.0013297833502292633,
      "pose_mae_dtheta": 0.06802936643362045,
      "pose_mae_dx": 0.015126878395676613,
      "pose_mae_dy": 0.0171249620616436,
      "pose_rmse_dtheta": 0.22452907264232635,
      "pose_rmse_dx": 0.043709203600883484,
      "pose_rmse_dy": 0.044231873005628586,
      "pose_rmse_mean": 0.10415671765804291,
      "rmse_dtheta": 0.028258904814720154,
      "rmse_dx": 0.005582614801824093,
      "rmse_dy": 0.0030945250764489174,
      "rmse_mean": 0.012312015518546104,
      "rotation_flip": 0.0038200339768081903,
      "sparse_tokens": 32137.0,
      "step": 9620,
      "turn_loss": 0.06855978816747665,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.44698940717338786,
      "grad_norm": 0.5127476453781128,
      "learning_rate": 9.580260141654057e-07,
      "loss": 0.1029,
      "mae_dtheta": 0.032521333545446396,
      "mae_dx": 0.010260687209665775,
      "mae_dy": 0.005104564130306244,
      "pose_mae_dtheta": 0.22941282391548157,
      "pose_mae_dx": 0.09522753208875656,
      "pose_mae_dy": 0.0668686255812645,
      "pose_rmse_dtheta": 0.40058401226997375,
      "pose_rmse_dx": 0.20715934038162231,
      "pose_rmse_dy": 0.14338761568069458,
      "pose_rmse_mean": 0.25037699937820435,
      "rmse_dtheta": 0.05061474069952965,
      "rmse_dx": 0.022640936076641083,
      "rmse_dy": 0.008641733787953854,
      "rmse_mean": 0.02729913592338562,
      "rotation_flip": 0.00948509480804205,
      "sparse_tokens": 12683.0,
      "step": 9621,
      "turn_loss": 0.22985222935676575,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.44703586693923064,
      "grad_norm": 0.8221532106399536,
      "learning_rate": 9.572478435332355e-07,
      "loss": 0.2344,
      "mae_dtheta": 0.029420675709843636,
      "mae_dx": 0.007023365702480078,
      "mae_dy": 0.003818175056949258,
      "pose_mae_dtheta": 0.20283222198486328,
      "pose_mae_dx": 0.060459066182374954,
      "pose_mae_dy": 0.050792109221220016,
      "pose_rmse_dtheta": 0.4222535490989685,
      "pose_rmse_dx": 0.14564748108386993,
      "pose_rmse_dy": 0.1486658751964569,
      "pose_rmse_mean": 0.23885564506053925,
      "rmse_dtheta": 0.04924307018518448,
      "rmse_dx": 0.017353417351841927,
      "rmse_dy": 0.009649133309721947,
      "rmse_mean": 0.02541520819067955,
      "rotation_flip": 0.013953488320112228,
      "sparse_tokens": 18513.0,
      "step": 9622,
      "turn_loss": 0.20837239921092987,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 27818.0,
      "epoch": 0.4470823267050734,
      "grad_norm": 0.4972878396511078,
      "learning_rate": 9.564699556128921e-07,
      "loss": 0.1605,
      "mae_dtheta": 0.03628384694457054,
      "mae_dx": 0.010845568962395191,
      "mae_dy": 0.004365405533462763,
      "pose_mae_dtheta": 0.2919159531593323,
      "pose_mae_dx": 0.09964330494403839,
      "pose_mae_dy": 0.053935516625642776,
      "pose_rmse_dtheta": 0.5145384669303894,
      "pose_rmse_dx": 0.20365279912948608,
      "pose_rmse_dy": 0.12122621387243271,
      "pose_rmse_mean": 0.27980583906173706,
      "rmse_dtheta": 0.05386889725923538,
      "rmse_dx": 0.022041400894522667,
      "rmse_dy": 0.009240376763045788,
      "rmse_mean": 0.028383558616042137,
      "rotation_flip": 0.012555391527712345,
      "sparse_tokens": 21561.0,
      "step": 9623,
      "turn_loss": 0.2841961085796356,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.4471287864709162,
      "grad_norm": 0.5206182599067688,
      "learning_rate": 9.556923504587761e-07,
      "loss": 0.1055,
      "mae_dtheta": 0.028424039483070374,
      "mae_dx": 0.009837890043854713,
      "mae_dy": 0.0036559905856847763,
      "pose_mae_dtheta": 0.24971160292625427,
      "pose_mae_dx": 0.08236706256866455,
      "pose_mae_dy": 0.06224394962191582,
      "pose_rmse_dtheta": 0.4694001078605652,
      "pose_rmse_dx": 0.21768198907375336,
      "pose_rmse_dy": 0.12109199911355972,
      "pose_rmse_mean": 0.26939138770103455,
      "rmse_dtheta": 0.04608142003417015,
      "rmse_dx": 0.022935405373573303,
      "rmse_dy": 0.006127933040261269,
      "rmse_mean": 0.025048254057765007,
      "rotation_flip": 0.002421307610347867,
      "sparse_tokens": 7284.0,
      "step": 9624,
      "turn_loss": 0.1831938922405243,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.44717524623675897,
      "grad_norm": 0.4419623017311096,
      "learning_rate": 9.549150281252633e-07,
      "loss": 0.0762,
      "mae_dtheta": 0.005028348881751299,
      "mae_dx": 0.0015617774333804846,
      "mae_dy": 0.0007583786500617862,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44196218252182007,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 169.94322204589844,
      "model/head/act_norm_mean": 128.65305397727272,
      "model/head/act_norm_min": 67.54439544677734,
      "model/head/act_over_embed": 88.41158316204987,
      "model/head/grad_frac": 0.09367668628692627,
      "model/head/grad_norm": 0.04140155389904976,
      "model/head/grad_zero_frac": 0.00019512213475536555,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7066021543560606,
      "model/head/update_ratio": 0.0007048852858133614,
      "model/head/weight_delta": 9.923125267028809,
      "model/head/weight_delta_rel": 0.1740810126066208,
      "model/head/weight_norm": 58.735164642333984,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4227735698223114,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4226831584216253,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226120710372925,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904718236894171,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11703816801309586,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05172644555568695,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.4782124001141553,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016702372813597322,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1422064304351807,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10266567766666412,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969518661499023,
      "model/modality_embedder/grad_frac": 0.11703816801309586,
      "model/modality_embedder/grad_norm": 0.05172644555568695,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.4782124001141553,
      "model/modality_embedder/update_ratio": 0.0016702372813597322,
      "model/modality_embedder/weight_delta": 3.1422064304351807,
      "model/modality_embedder/weight_delta_rel": 0.10266567766666412,
      "model/modality_embedder/weight_norm": 30.969518661499023,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 95.330810546875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.360642636684304,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.954241752624512,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.42807105000659,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.04785453900694847,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0211498960852623,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007566024432890117,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7090396881103516,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0987190380692482,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.953777313232422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 96.46965789794922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.315932138848805,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.355329513549805,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.084554939455263,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.04989044368267059,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.022049689665436745,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.00074094528099522,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.435197114944458,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11899791657924652,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.75886344909668,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 97.98684692382812,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.072470739137405,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.277020454406738,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.29166471054706,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0531141459941864,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.023474443703889847,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007639093673788011,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7193918228149414,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12489021569490433,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.72935676574707,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 98.510986328125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.704833553791886,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.376994132995605,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.41343971919907,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05733909085392952,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.025341710075736046,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008462608093395829,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1944515705108643,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10917119681835175,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.94550895690918,
      "model/normalizer/grad_frac": 0.20269177854061127,
      "model/normalizer/grad_norm": 0.08958210051059723,
      "model/normalizer/grad_zero_frac": 0.00028125374228693545,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0011390772415325046,
      "model/normalizer/weight_delta": 6.723870277404785,
      "model/normalizer/weight_delta_rel": 0.08659955859184265,
      "model/normalizer/weight_norm": 78.64444732666016,
      "pose_mae_dtheta": 0.032239288091659546,
      "pose_mae_dx": 0.013682383112609386,
      "pose_mae_dy": 0.007804078049957752,
      "pose_rmse_dtheta": 0.1091209128499031,
      "pose_rmse_dx": 0.04942415654659271,
      "pose_rmse_dy": 0.022402117028832436,
      "pose_rmse_mean": 0.06031573563814163,
      "rmse_dtheta": 0.01767289824783802,
      "rmse_dx": 0.005907506216317415,
      "rmse_dy": 0.002474296372383833,
      "rmse_mean": 0.008684900589287281,
      "rotation_flip": 0.005071851424872875,
      "sparse_tokens": 32073.0,
      "step": 9625,
      "turn_loss": 0.04384065046906471,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.44722170600260175,
      "grad_norm": 0.47738116979599,
      "learning_rate": 9.541379886667151e-07,
      "loss": 0.0887,
      "mae_dtheta": 0.01495618186891079,
      "mae_dx": 0.002616367070004344,
      "mae_dy": 0.003956275526434183,
      "pose_mae_dtheta": 0.09714685380458832,
      "pose_mae_dx": 0.034147270023822784,
      "pose_mae_dy": 0.03932718187570572,
      "pose_rmse_dtheta": 0.21921057999134064,
      "pose_rmse_dx": 0.07933837920427322,
      "pose_rmse_dy": 0.0811983272433281,
      "pose_rmse_mean": 0.12658244371414185,
      "rmse_dtheta": 0.029340054839849472,
      "rmse_dx": 0.007821924053132534,
      "rmse_dy": 0.00885810051113367,
      "rmse_mean": 0.015340026468038559,
      "rotation_flip": 0.008421708829700947,
      "sparse_tokens": 32121.0,
      "step": 9626,
      "turn_loss": 0.1296481192111969,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4472681657684445,
      "grad_norm": 0.6765863299369812,
      "learning_rate": 9.533612321374674e-07,
      "loss": 0.1339,
      "mae_dtheta": 0.012182973325252533,
      "mae_dx": 0.0025460589677095413,
      "mae_dy": 0.00375673221424222,
      "pose_mae_dtheta": 0.0849422886967659,
      "pose_mae_dx": 0.03386098891496658,
      "pose_mae_dy": 0.034522175788879395,
      "pose_rmse_dtheta": 0.1919228881597519,
      "pose_rmse_dx": 0.08862725645303726,
      "pose_rmse_dy": 0.08730529248714447,
      "pose_rmse_mean": 0.12261848151683807,
      "rmse_dtheta": 0.024980152025818825,
      "rmse_dx": 0.0064271665178239346,
      "rmse_dy": 0.008315224200487137,
      "rmse_mean": 0.013240847736597061,
      "rotation_flip": 0.006211180239915848,
      "sparse_tokens": 32137.0,
      "step": 9627,
      "turn_loss": 0.12566180527210236,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.4473146255342873,
      "grad_norm": 0.9742506742477417,
      "learning_rate": 9.525847585918424e-07,
      "loss": 0.2632,
      "mae_dtheta": 0.036591846495866776,
      "mae_dx": 0.012683824636042118,
      "mae_dy": 0.0061683449894189835,
      "pose_mae_dtheta": 0.3118922710418701,
      "pose_mae_dx": 0.10759950429201126,
      "pose_mae_dy": 0.05968977510929108,
      "pose_rmse_dtheta": 0.5827245712280273,
      "pose_rmse_dx": 0.2446051985025406,
      "pose_rmse_dy": 0.14795170724391937,
      "pose_rmse_mean": 0.3250938355922699,
      "rmse_dtheta": 0.057674020528793335,
      "rmse_dx": 0.025186752900481224,
      "rmse_dy": 0.014008354395627975,
      "rmse_mean": 0.03228970989584923,
      "rotation_flip": 0.015315315686166286,
      "sparse_tokens": 17986.0,
      "step": 9628,
      "turn_loss": 0.29624494910240173,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4473610853001301,
      "grad_norm": 0.4984230697154999,
      "learning_rate": 9.518085680841366e-07,
      "loss": 0.1344,
      "mae_dtheta": 0.010691030882298946,
      "mae_dx": 0.0015319379745051265,
      "mae_dy": 0.002243973081931472,
      "pose_mae_dtheta": 0.08108855783939362,
      "pose_mae_dx": 0.0158475860953331,
      "pose_mae_dy": 0.025008181110024452,
      "pose_rmse_dtheta": 0.24183452129364014,
      "pose_rmse_dx": 0.049229323863983154,
      "pose_rmse_dy": 0.0948566123843193,
      "pose_rmse_mean": 0.12864015996456146,
      "rmse_dtheta": 0.027496609836816788,
      "rmse_dx": 0.004971720743924379,
      "rmse_dy": 0.007067888043820858,
      "rmse_mean": 0.013178739696741104,
      "rotation_flip": 0.0037767519243061543,
      "sparse_tokens": 32121.0,
      "step": 9629,
      "turn_loss": 0.09611615538597107,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.44740754506597286,
      "grad_norm": 0.4076874554157257,
      "learning_rate": 9.51032660668631e-07,
      "loss": 0.0779,
      "mae_dtheta": 0.02921670489013195,
      "mae_dx": 0.009591192938387394,
      "mae_dy": 0.0059504215605556965,
      "pose_mae_dtheta": 0.2286689579486847,
      "pose_mae_dx": 0.09483958780765533,
      "pose_mae_dy": 0.08447971940040588,
      "pose_rmse_dtheta": 0.4196952283382416,
      "pose_rmse_dx": 0.19821885228157043,
      "pose_rmse_dy": 0.1988757848739624,
      "pose_rmse_mean": 0.2722632884979248,
      "rmse_dtheta": 0.045409005135297775,
      "rmse_dx": 0.020036917179822922,
      "rmse_dy": 0.010760041885077953,
      "rmse_mean": 0.02540198713541031,
      "rotation_flip": 0.013189448043704033,
      "sparse_tokens": 14096.0,
      "step": 9630,
      "turn_loss": 0.22856992483139038,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.44745400483181563,
      "grad_norm": 0.5127711892127991,
      "learning_rate": 9.502570363995839e-07,
      "loss": 0.1176,
      "mae_dtheta": 0.010114416480064392,
      "mae_dx": 0.0019147524144500494,
      "mae_dy": 0.0024252922739833593,
      "pose_mae_dtheta": 0.07075835019350052,
      "pose_mae_dx": 0.018565645441412926,
      "pose_mae_dy": 0.024099333211779594,
      "pose_rmse_dtheta": 0.21563532948493958,
      "pose_rmse_dx": 0.04732197895646095,
      "pose_rmse_dy": 0.05946557968854904,
      "pose_rmse_mean": 0.10747429728507996,
      "rmse_dtheta": 0.027227552607655525,
      "rmse_dx": 0.007871385663747787,
      "rmse_dy": 0.006719406694173813,
      "rmse_mean": 0.013939449563622475,
      "rotation_flip": 0.0014316391898319125,
      "sparse_tokens": 32169.0,
      "step": 9631,
      "turn_loss": 0.09885222464799881,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19155.0,
      "epoch": 0.4475004645976584,
      "grad_norm": 0.9333288669586182,
      "learning_rate": 9.494816953312353e-07,
      "loss": 0.2628,
      "mae_dtheta": 0.032916802912950516,
      "mae_dx": 0.0086815245449543,
      "mae_dy": 0.0057498859241604805,
      "pose_mae_dtheta": 0.2373049110174179,
      "pose_mae_dx": 0.06513996422290802,
      "pose_mae_dy": 0.052945222705602646,
      "pose_rmse_dtheta": 0.43529003858566284,
      "pose_rmse_dx": 0.18007902801036835,
      "pose_rmse_dy": 0.12720589339733124,
      "pose_rmse_mean": 0.24752500653266907,
      "rmse_dtheta": 0.05304480344057083,
      "rmse_dx": 0.019566403701901436,
      "rmse_dy": 0.0131608247756958,
      "rmse_mean": 0.028590677306056023,
      "rotation_flip": 0.017223911359906197,
      "sparse_tokens": 15384.0,
      "step": 9632,
      "turn_loss": 0.2670770287513733,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4475469243635012,
      "grad_norm": 0.4287314713001251,
      "learning_rate": 9.487066375178078e-07,
      "loss": 0.1212,
      "mae_dtheta": 0.006143251899629831,
      "mae_dx": 0.0015716198831796646,
      "mae_dy": 0.000989112420938909,
      "pose_mae_dtheta": 0.044145405292510986,
      "pose_mae_dx": 0.01362855825573206,
      "pose_mae_dy": 0.00976721290498972,
      "pose_rmse_dtheta": 0.18400965631008148,
      "pose_rmse_dx": 0.044444963335990906,
      "pose_rmse_dy": 0.04154587909579277,
      "pose_rmse_mean": 0.09000016748905182,
      "rmse_dtheta": 0.022331543266773224,
      "rmse_dx": 0.005137492902576923,
      "rmse_dy": 0.004131421912461519,
      "rmse_mean": 0.010533485561609268,
      "rotation_flip": 0.00410677632316947,
      "sparse_tokens": 32201.0,
      "step": 9633,
      "turn_loss": 0.04658426344394684,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.44759338412934396,
      "grad_norm": 0.38077086210250854,
      "learning_rate": 9.479318630134976e-07,
      "loss": 0.1169,
      "mae_dtheta": 0.009141874499619007,
      "mae_dx": 0.002062508137896657,
      "mae_dy": 0.0027428092435002327,
      "pose_mae_dtheta": 0.06638814508914948,
      "pose_mae_dx": 0.022616149857640266,
      "pose_mae_dy": 0.028849633410573006,
      "pose_rmse_dtheta": 0.1542675644159317,
      "pose_rmse_dx": 0.06957873702049255,
      "pose_rmse_dy": 0.07424578070640564,
      "pose_rmse_mean": 0.0993640273809433,
      "rmse_dtheta": 0.02151496894657612,
      "rmse_dx": 0.006515108048915863,
      "rmse_dy": 0.007785615976899862,
      "rmse_mean": 0.011938564479351044,
      "rotation_flip": 0.003634711494669318,
      "sparse_tokens": 32089.0,
      "step": 9634,
      "turn_loss": 0.09362871199846268,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1980.0,
      "epoch": 0.4476398438951868,
      "grad_norm": 0.5201737880706787,
      "learning_rate": 9.471573718724891e-07,
      "loss": 0.0866,
      "mae_dtheta": 0.060880351811647415,
      "mae_dx": 0.021807104349136353,
      "mae_dy": 0.008295620791614056,
      "pose_mae_dtheta": 0.5124368667602539,
      "pose_mae_dx": 0.15155169367790222,
      "pose_mae_dy": 0.12172308564186096,
      "pose_rmse_dtheta": 0.8210579752922058,
      "pose_rmse_dx": 0.28128185868263245,
      "pose_rmse_dy": 0.2938101589679718,
      "pose_rmse_mean": 0.4653833508491516,
      "rmse_dtheta": 0.07926071435213089,
      "rmse_dx": 0.03530104458332062,
      "rmse_dy": 0.01675848849117756,
      "rmse_mean": 0.04377342015504837,
      "rotation_flip": 0.01886792480945587,
      "sparse_tokens": 1713.0,
      "step": 9635,
      "turn_loss": 0.5664355754852295,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.44768630366102957,
      "grad_norm": 0.5586382150650024,
      "learning_rate": 9.463831641489391e-07,
      "loss": 0.0828,
      "mae_dtheta": 0.0088697774335742,
      "mae_dx": 0.0030062522273510695,
      "mae_dy": 0.003603839548304677,
      "pose_mae_dtheta": 0.06326087564229965,
      "pose_mae_dx": 0.03144662082195282,
      "pose_mae_dy": 0.02522057481110096,
      "pose_rmse_dtheta": 0.1392488032579422,
      "pose_rmse_dx": 0.07741329073905945,
      "pose_rmse_dy": 0.054075684398412704,
      "pose_rmse_mean": 0.09024592489004135,
      "rmse_dtheta": 0.017730511724948883,
      "rmse_dx": 0.007084489334374666,
      "rmse_dy": 0.007242381107062101,
      "rmse_mean": 0.010685794055461884,
      "rotation_flip": 0.0028704700525850058,
      "sparse_tokens": 32137.0,
      "step": 9636,
      "turn_loss": 0.09505899995565414,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.44773276342687235,
      "grad_norm": 0.6438028812408447,
      "learning_rate": 9.456092398969902e-07,
      "loss": 0.1409,
      "mae_dtheta": 0.030305838212370872,
      "mae_dx": 0.011485475115478039,
      "mae_dy": 0.005184645764529705,
      "pose_mae_dtheta": 0.24634145200252533,
      "pose_mae_dx": 0.09946434944868088,
      "pose_mae_dy": 0.05258243903517723,
      "pose_rmse_dtheta": 0.4432712197303772,
      "pose_rmse_dx": 0.21864654123783112,
      "pose_rmse_dy": 0.14579392969608307,
      "pose_rmse_mean": 0.269237220287323,
      "rmse_dtheta": 0.0495944581925869,
      "rmse_dx": 0.023572301492094994,
      "rmse_dy": 0.01114057656377554,
      "rmse_mean": 0.028102446347475052,
      "rotation_flip": 0.012939001433551311,
      "sparse_tokens": 19361.0,
      "step": 9637,
      "turn_loss": 0.24887621402740479,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.4477792231927151,
      "grad_norm": 0.525140106678009,
      "learning_rate": 9.448355991707647e-07,
      "loss": 0.1224,
      "mae_dtheta": 0.025281650945544243,
      "mae_dx": 0.008675017394125462,
      "mae_dy": 0.0016368587967008352,
      "pose_mae_dtheta": 0.17919887602329254,
      "pose_mae_dx": 0.07105034589767456,
      "pose_mae_dy": 0.021342040970921516,
      "pose_rmse_dtheta": 0.3750719428062439,
      "pose_rmse_dx": 0.1909226030111313,
      "pose_rmse_dy": 0.055350545793771744,
      "pose_rmse_mean": 0.207115039229393,
      "rmse_dtheta": 0.04589388146996498,
      "rmse_dx": 0.02072090096771717,
      "rmse_dy": 0.0035649961791932583,
      "rmse_mean": 0.023393262177705765,
      "rotation_flip": 0.002239641733467579,
      "sparse_tokens": 14063.0,
      "step": 9638,
      "turn_loss": 0.2062641680240631,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4478256829585579,
      "grad_norm": 0.5077126622200012,
      "learning_rate": 9.440622420243611e-07,
      "loss": 0.0845,
      "mae_dtheta": 0.006067013833671808,
      "mae_dx": 0.0011428848374634981,
      "mae_dy": 0.0007233390933834016,
      "pose_mae_dtheta": 0.04401213303208351,
      "pose_mae_dx": 0.009938239119946957,
      "pose_mae_dy": 0.008718673139810562,
      "pose_rmse_dtheta": 0.18513403832912445,
      "pose_rmse_dx": 0.024997815489768982,
      "pose_rmse_dy": 0.02212538570165634,
      "pose_rmse_mean": 0.07741908729076385,
      "rmse_dtheta": 0.021099437028169632,
      "rmse_dx": 0.0033265019301325083,
      "rmse_dy": 0.001648317789658904,
      "rmse_mean": 0.008691418915987015,
      "rotation_flip": 0.0018501387676224113,
      "sparse_tokens": 32201.0,
      "step": 9639,
      "turn_loss": 0.04244091361761093,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4478721427244007,
      "grad_norm": 0.37350600957870483,
      "learning_rate": 9.432891685118628e-07,
      "loss": 0.088,
      "mae_dtheta": 0.007597032003104687,
      "mae_dx": 0.0021328970324248075,
      "mae_dy": 0.002025302965193987,
      "pose_mae_dtheta": 0.05206876993179321,
      "pose_mae_dx": 0.02438296563923359,
      "pose_mae_dy": 0.018460720777511597,
      "pose_rmse_dtheta": 0.14822950959205627,
      "pose_rmse_dx": 0.08390898257493973,
      "pose_rmse_dy": 0.05996051803231239,
      "pose_rmse_mean": 0.0973663330078125,
      "rmse_dtheta": 0.018974777311086655,
      "rmse_dx": 0.0070807114243507385,
      "rmse_dy": 0.005862897727638483,
      "rmse_mean": 0.010639462620019913,
      "rotation_flip": 0.004984141327440739,
      "sparse_tokens": 32089.0,
      "step": 9640,
      "turn_loss": 0.06059947982430458,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.44791860249024346,
      "grad_norm": 0.7126335501670837,
      "learning_rate": 9.425163786873292e-07,
      "loss": 0.1004,
      "mae_dtheta": 0.032030463218688965,
      "mae_dx": 0.005184383597224951,
      "mae_dy": 0.0028672590851783752,
      "pose_mae_dtheta": 0.23275026679039001,
      "pose_mae_dx": 0.031624387949705124,
      "pose_mae_dy": 0.01906413957476616,
      "pose_rmse_dtheta": 0.49041008949279785,
      "pose_rmse_dx": 0.09287995845079422,
      "pose_rmse_dy": 0.04066450148820877,
      "pose_rmse_mean": 0.20798484981060028,
      "rmse_dtheta": 0.05364925041794777,
      "rmse_dx": 0.014393866062164307,
      "rmse_dy": 0.005912000313401222,
      "rmse_mean": 0.024651704356074333,
      "rotation_flip": 0.016574585810303688,
      "sparse_tokens": 7047.0,
      "step": 9641,
      "turn_loss": 0.16884492337703705,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.44796506225608623,
      "grad_norm": 0.8037565350532532,
      "learning_rate": 9.417438726048045e-07,
      "loss": 0.1451,
      "mae_dtheta": 0.030173812061548233,
      "mae_dx": 0.005801776889711618,
      "mae_dy": 0.005338246002793312,
      "pose_mae_dtheta": 0.17888446152210236,
      "pose_mae_dx": 0.03281140699982643,
      "pose_mae_dy": 0.0459592379629612,
      "pose_rmse_dtheta": 0.3886965215206146,
      "pose_rmse_dx": 0.06647005677223206,
      "pose_rmse_dy": 0.0955226793885231,
      "pose_rmse_mean": 0.18356309831142426,
      "rmse_dtheta": 0.049781713634729385,
      "rmse_dx": 0.013705570250749588,
      "rmse_dy": 0.010153558105230331,
      "rmse_mean": 0.024546947330236435,
      "rotation_flip": 0.004716981202363968,
      "sparse_tokens": 3516.0,
      "step": 9642,
      "turn_loss": 0.26233550906181335,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.448011522021929,
      "grad_norm": 0.33562082052230835,
      "learning_rate": 9.409716503183075e-07,
      "loss": 0.061,
      "mae_dtheta": 0.0078039029613137245,
      "mae_dx": 0.0009567994275130332,
      "mae_dy": 0.0018570080865174532,
      "pose_mae_dtheta": 0.051394976675510406,
      "pose_mae_dx": 0.011721407063305378,
      "pose_mae_dy": 0.0199567973613739,
      "pose_rmse_dtheta": 0.1799309104681015,
      "pose_rmse_dx": 0.027655664831399918,
      "pose_rmse_dy": 0.04593904688954353,
      "pose_rmse_mean": 0.08450853824615479,
      "rmse_dtheta": 0.019981324672698975,
      "rmse_dx": 0.0027994923293590546,
      "rmse_dy": 0.004108257591724396,
      "rmse_mean": 0.008963025175035,
      "rotation_flip": 0.004656577482819557,
      "sparse_tokens": 32089.0,
      "step": 9643,
      "turn_loss": 0.0612059012055397,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4480579817877718,
      "grad_norm": 0.4323841631412506,
      "learning_rate": 9.401997118818418e-07,
      "loss": 0.1101,
      "mae_dtheta": 0.00613004993647337,
      "mae_dx": 0.0010418014135211706,
      "mae_dy": 0.0017713599372655153,
      "pose_mae_dtheta": 0.03998326510190964,
      "pose_mae_dx": 0.013681949116289616,
      "pose_mae_dy": 0.016603372991085052,
      "pose_rmse_dtheta": 0.08236608654260635,
      "pose_rmse_dx": 0.03520410880446434,
      "pose_rmse_dy": 0.03788989037275314,
      "pose_rmse_mean": 0.05182003229856491,
      "rmse_dtheta": 0.013983715325593948,
      "rmse_dx": 0.002786976518109441,
      "rmse_dy": 0.004032693337649107,
      "rmse_mean": 0.0069344621151685715,
      "rotation_flip": 0.0038759689778089523,
      "sparse_tokens": 32089.0,
      "step": 9644,
      "turn_loss": 0.049203697592020035,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6499.0,
      "epoch": 0.44810444155361456,
      "grad_norm": 0.4393914043903351,
      "learning_rate": 9.394280573493903e-07,
      "loss": 0.0801,
      "mae_dtheta": 0.030557412654161453,
      "mae_dx": 0.008453152142465115,
      "mae_dy": 0.0027726120315492153,
      "pose_mae_dtheta": 0.2538125514984131,
      "pose_mae_dx": 0.057796817272901535,
      "pose_mae_dy": 0.026247086003422737,
      "pose_rmse_dtheta": 0.5257644057273865,
      "pose_rmse_dx": 0.16821524500846863,
      "pose_rmse_dy": 0.061708103865385056,
      "pose_rmse_mean": 0.2518959045410156,
      "rmse_dtheta": 0.052108000963926315,
      "rmse_dx": 0.019129276275634766,
      "rmse_dy": 0.0069722821936011314,
      "rmse_mean": 0.02606985531747341,
      "rotation_flip": 0.010309278033673763,
      "sparse_tokens": 5356.0,
      "step": 9645,
      "turn_loss": 0.1861688494682312,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.44815090131945734,
      "grad_norm": 0.8281687498092651,
      "learning_rate": 9.386566867749131e-07,
      "loss": 0.1514,
      "mae_dtheta": 0.029385685920715332,
      "mae_dx": 0.008968489244580269,
      "mae_dy": 0.00510175246745348,
      "pose_mae_dtheta": 0.2384471446275711,
      "pose_mae_dx": 0.08584859222173691,
      "pose_mae_dy": 0.08142361044883728,
      "pose_rmse_dtheta": 0.4622177481651306,
      "pose_rmse_dx": 0.20658959448337555,
      "pose_rmse_dy": 0.2060459405183792,
      "pose_rmse_mean": 0.291617751121521,
      "rmse_dtheta": 0.0491335391998291,
      "rmse_dx": 0.020585916936397552,
      "rmse_dy": 0.011558209545910358,
      "rmse_mean": 0.02709255740046501,
      "rotation_flip": 0.005730659235268831,
      "sparse_tokens": 7000.0,
      "step": 9646,
      "turn_loss": 0.22170686721801758,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.4481973610853001,
      "grad_norm": 0.4260534644126892,
      "learning_rate": 9.378856002123549e-07,
      "loss": 0.119,
      "mae_dtheta": 0.03978889435529709,
      "mae_dx": 0.01414903998374939,
      "mae_dy": 0.00790899433195591,
      "pose_mae_dtheta": 0.3071441352367401,
      "pose_mae_dx": 0.12170834094285965,
      "pose_mae_dy": 0.08355235308408737,
      "pose_rmse_dtheta": 0.5354853272438049,
      "pose_rmse_dx": 0.26494938135147095,
      "pose_rmse_dy": 0.1839783936738968,
      "pose_rmse_mean": 0.32813769578933716,
      "rmse_dtheta": 0.05915094539523125,
      "rmse_dx": 0.02699286863207817,
      "rmse_dy": 0.016019446775317192,
      "rmse_mean": 0.03405442088842392,
      "rotation_flip": 0.013002363964915276,
      "sparse_tokens": 14511.0,
      "step": 9647,
      "turn_loss": 0.365278035402298,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4482438208511429,
      "grad_norm": 0.32673782110214233,
      "learning_rate": 9.371147977156359e-07,
      "loss": 0.0648,
      "mae_dtheta": 0.007240631151944399,
      "mae_dx": 0.001149865216575563,
      "mae_dy": 0.001435383572243154,
      "pose_mae_dtheta": 0.04753004387021065,
      "pose_mae_dx": 0.01528134010732174,
      "pose_mae_dy": 0.01583869569003582,
      "pose_rmse_dtheta": 0.14035187661647797,
      "pose_rmse_dx": 0.0389002226293087,
      "pose_rmse_dy": 0.03924751281738281,
      "pose_rmse_mean": 0.07283321022987366,
      "rmse_dtheta": 0.019262613728642464,
      "rmse_dx": 0.003010333748534322,
      "rmse_dy": 0.0034878996666520834,
      "rmse_mean": 0.008586949668824673,
      "rotation_flip": 0.0014646649360656738,
      "sparse_tokens": 32185.0,
      "step": 9648,
      "turn_loss": 0.05222970247268677,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.44829028061698567,
      "grad_norm": 0.6107510328292847,
      "learning_rate": 9.363442793386606e-07,
      "loss": 0.1095,
      "mae_dtheta": 0.023579802364110947,
      "mae_dx": 0.010442182421684265,
      "mae_dy": 0.002517334884032607,
      "pose_mae_dtheta": 0.1750124990940094,
      "pose_mae_dx": 0.10581482946872711,
      "pose_mae_dy": 0.03495573252439499,
      "pose_rmse_dtheta": 0.3506479263305664,
      "pose_rmse_dx": 0.22615428268909454,
      "pose_rmse_dy": 0.11345343291759491,
      "pose_rmse_mean": 0.23008522391319275,
      "rmse_dtheta": 0.04322385787963867,
      "rmse_dx": 0.022147459909319878,
      "rmse_dy": 0.005991789512336254,
      "rmse_mean": 0.02378770336508751,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 10003.0,
      "step": 9649,
      "turn_loss": 0.20685157179832458,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.44833674038282845,
      "grad_norm": 0.414826899766922,
      "learning_rate": 9.355740451353101e-07,
      "loss": 0.0896,
      "mae_dtheta": 0.008860005997121334,
      "mae_dx": 0.0018176590092480183,
      "mae_dy": 0.002274988451972604,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4148268699645996,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.92092895507812,
      "model/head/act_norm_mean": 109.28867779356061,
      "model/head/act_norm_min": 66.27244567871094,
      "model/head/act_over_embed": 75.10420255645677,
      "model/head/grad_frac": 0.12113449722528458,
      "model/head/grad_norm": 0.050249844789505005,
      "model/head/grad_zero_frac": 0.000162443146109581,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7040029198232324,
      "model/head/update_ratio": 0.0008555271779187024,
      "model/head/weight_delta": 9.924710273742676,
      "model/head/weight_delta_rel": 0.1741088181734085,
      "model/head/weight_norm": 58.73553466796875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42278313636779785,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4226846568910036,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42258986830711365,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29047285345160273,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08674847334623337,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03598559647798538,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5409640005506607,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011619697324931622,
      "model/modality_embedder.encoders.pose/weight_delta": 3.142660140991211,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.102680504322052,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969478607177734,
      "model/modality_embedder/grad_frac": 0.08674847334623337,
      "model/modality_embedder/grad_norm": 0.03598559647798538,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5409640005506607,
      "model/modality_embedder/update_ratio": 0.0011619697324931622,
      "model/modality_embedder/weight_delta": 3.142660140991211,
      "model/modality_embedder/weight_delta_rel": 0.102680504322052,
      "model/modality_embedder/weight_norm": 30.969478607177734,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.93478393554688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.57922729276896,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.132903099060059,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.20386574779475,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08522344380617142,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03535297513008118,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001264685532078147,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7101263999938965,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09875863790512085,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.953964233398438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.77307891845703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.57463524130191,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.389293670654297,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.887919409182633,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08853291720151901,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.036725834012031555,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012341034598648548,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.436387777328491,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1190391555428505,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.75912094116211,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.39591979980469,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.39988425925926,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.226032257080078,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.14224762257346,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09025456756353378,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.037440020591020584,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012183643411844969,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7209086418151855,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1249411478638649,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.729740142822266,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.05928802490234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.10804974346641,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.720614433288574,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.316114935417836,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09780104458332062,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04057050123810768,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013548003043979406,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.195816993713379,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10921785980463028,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.945741653442383,
      "model/normalizer/grad_frac": 0.3497958481311798,
      "model/normalizer/grad_norm": 0.14510472118854523,
      "model/normalizer/grad_zero_frac": 0.0002517102693673223,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018450641073286533,
      "model/normalizer/weight_delta": 6.726512432098389,
      "model/normalizer/weight_delta_rel": 0.0866335853934288,
      "model/normalizer/weight_norm": 78.64481353759766,
      "pose_mae_dtheta": 0.055348217487335205,
      "pose_mae_dx": 0.019800908863544464,
      "pose_mae_dy": 0.02345200441777706,
      "pose_rmse_dtheta": 0.14599938690662384,
      "pose_rmse_dx": 0.05199723690748215,
      "pose_rmse_dy": 0.05753638222813606,
      "pose_rmse_mean": 0.08517767488956451,
      "rmse_dtheta": 0.020630618557333946,
      "rmse_dx": 0.005696448497474194,
      "rmse_dy": 0.005304782185703516,
      "rmse_mean": 0.010543949902057648,
      "rotation_flip": 0.002199413487687707,
      "sparse_tokens": 32137.0,
      "step": 9650,
      "turn_loss": 0.07121767103672028,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4483832001486712,
      "grad_norm": 0.37431418895721436,
      "learning_rate": 9.348040951594478e-07,
      "loss": 0.089,
      "mae_dtheta": 0.010433546267449856,
      "mae_dx": 0.0014360211789608002,
      "mae_dy": 0.00142294866964221,
      "pose_mae_dtheta": 0.06449010223150253,
      "pose_mae_dx": 0.016258427873253822,
      "pose_mae_dy": 0.02169935032725334,
      "pose_rmse_dtheta": 0.17292791604995728,
      "pose_rmse_dx": 0.04239166900515556,
      "pose_rmse_dy": 0.06030917540192604,
      "pose_rmse_mean": 0.09187626093626022,
      "rmse_dtheta": 0.02448158711194992,
      "rmse_dx": 0.004603077191859484,
      "rmse_dy": 0.0029735087882727385,
      "rmse_mean": 0.0106860576197505,
      "rotation_flip": 0.004739336669445038,
      "sparse_tokens": 32137.0,
      "step": 9651,
      "turn_loss": 0.0689968466758728,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.44842965991451406,
      "grad_norm": 0.5207644104957581,
      "learning_rate": 9.340344294649184e-07,
      "loss": 0.1412,
      "mae_dtheta": 0.029916448518633842,
      "mae_dx": 0.005602042656391859,
      "mae_dy": 0.0024968646466732025,
      "pose_mae_dtheta": 0.19160491228103638,
      "pose_mae_dx": 0.03563116490840912,
      "pose_mae_dy": 0.02181677706539631,
      "pose_rmse_dtheta": 0.4235779643058777,
      "pose_rmse_dx": 0.10150518268346786,
      "pose_rmse_dy": 0.05108211934566498,
      "pose_rmse_mean": 0.1920550912618637,
      "rmse_dtheta": 0.05352768674492836,
      "rmse_dx": 0.014464654959738255,
      "rmse_dy": 0.0054460614919662476,
      "rmse_mean": 0.024479469284415245,
      "rotation_flip": 0.007683863863348961,
      "sparse_tokens": 15110.0,
      "step": 9652,
      "turn_loss": 0.18232756853103638,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.44847611968035683,
      "grad_norm": 0.36387205123901367,
      "learning_rate": 9.332650481055422e-07,
      "loss": 0.0777,
      "mae_dtheta": 0.036572519689798355,
      "mae_dx": 0.008936280384659767,
      "mae_dy": 0.003987734671682119,
      "pose_mae_dtheta": 0.2546732723712921,
      "pose_mae_dx": 0.06656476110219955,
      "pose_mae_dy": 0.06551141291856766,
      "pose_rmse_dtheta": 0.47554725408554077,
      "pose_rmse_dx": 0.16836097836494446,
      "pose_rmse_dy": 0.12095862627029419,
      "pose_rmse_mean": 0.2549556493759155,
      "rmse_dtheta": 0.05814293399453163,
      "rmse_dx": 0.022005146369338036,
      "rmse_dy": 0.006961454171687365,
      "rmse_mean": 0.029036512598395348,
      "rotation_flip": 0.01092896144837141,
      "sparse_tokens": 6293.0,
      "step": 9653,
      "turn_loss": 0.17482098937034607,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4485225794461996,
      "grad_norm": 0.5792838335037231,
      "learning_rate": 9.324959511351256e-07,
      "loss": 0.1561,
      "mae_dtheta": 0.01048575434833765,
      "mae_dx": 0.0013169506564736366,
      "mae_dy": 0.0022856753785163164,
      "pose_mae_dtheta": 0.06972155719995499,
      "pose_mae_dx": 0.019292689859867096,
      "pose_mae_dy": 0.02446722611784935,
      "pose_rmse_dtheta": 0.2081129103899002,
      "pose_rmse_dx": 0.04931178689002991,
      "pose_rmse_dy": 0.056185103952884674,
      "pose_rmse_mean": 0.10453660786151886,
      "rmse_dtheta": 0.024844635277986526,
      "rmse_dx": 0.003761249827221036,
      "rmse_dy": 0.004783677868545055,
      "rmse_mean": 0.011129855178296566,
      "rotation_flip": 0.004221028182655573,
      "sparse_tokens": 32089.0,
      "step": 9654,
      "turn_loss": 0.07623877376317978,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4485690392120424,
      "grad_norm": 0.3677971363067627,
      "learning_rate": 9.317271386074489e-07,
      "loss": 0.0698,
      "mae_dtheta": 0.009315152652561665,
      "mae_dx": 0.0015287087298929691,
      "mae_dy": 0.0007831347757019103,
      "pose_mae_dtheta": 0.06696688383817673,
      "pose_mae_dx": 0.012468371540307999,
      "pose_mae_dy": 0.011632541194558144,
      "pose_rmse_dtheta": 0.22046509385108948,
      "pose_rmse_dx": 0.03026408702135086,
      "pose_rmse_dy": 0.036388177424669266,
      "pose_rmse_mean": 0.0957057923078537,
      "rmse_dtheta": 0.02763950265944004,
      "rmse_dx": 0.004699177108705044,
      "rmse_dy": 0.0019963053055107594,
      "rmse_mean": 0.011444995179772377,
      "rotation_flip": 0.002367424312978983,
      "sparse_tokens": 32201.0,
      "step": 9655,
      "turn_loss": 0.0642733946442604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.44861549897788516,
      "grad_norm": 0.663233757019043,
      "learning_rate": 9.309586105762786e-07,
      "loss": 0.1887,
      "mae_dtheta": 0.03680680692195892,
      "mae_dx": 0.008085581474006176,
      "mae_dy": 0.006480333860963583,
      "pose_mae_dtheta": 0.32625702023506165,
      "pose_mae_dx": 0.06662631034851074,
      "pose_mae_dy": 0.07653645426034927,
      "pose_rmse_dtheta": 0.49589017033576965,
      "pose_rmse_dx": 0.1469830870628357,
      "pose_rmse_dy": 0.17210868000984192,
      "pose_rmse_mean": 0.2716606557369232,
      "rmse_dtheta": 0.05103182792663574,
      "rmse_dx": 0.017706414684653282,
      "rmse_dy": 0.011871378868818283,
      "rmse_mean": 0.026869874447584152,
      "rotation_flip": 0.01484480407088995,
      "sparse_tokens": 12025.0,
      "step": 9656,
      "turn_loss": 0.33554062247276306,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.44866195874372794,
      "grad_norm": 0.5525714755058289,
      "learning_rate": 9.301903670953549e-07,
      "loss": 0.1045,
      "mae_dtheta": 0.00975384097546339,
      "mae_dx": 0.001836297451518476,
      "mae_dy": 0.0015894891694188118,
      "pose_mae_dtheta": 0.06329314410686493,
      "pose_mae_dx": 0.021131593734025955,
      "pose_mae_dy": 0.02117496356368065,
      "pose_rmse_dtheta": 0.1663961410522461,
      "pose_rmse_dx": 0.0503263883292675,
      "pose_rmse_dy": 0.04975014552474022,
      "pose_rmse_mean": 0.08882422745227814,
      "rmse_dtheta": 0.021921616047620773,
      "rmse_dx": 0.0054943617433309555,
      "rmse_dy": 0.0034550349228084087,
      "rmse_mean": 0.010290337726473808,
      "rotation_flip": 0.005820105783641338,
      "sparse_tokens": 32073.0,
      "step": 9657,
      "turn_loss": 0.08477671444416046,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29431.0,
      "epoch": 0.4487084185095707,
      "grad_norm": 0.6311785578727722,
      "learning_rate": 9.294224082184045e-07,
      "loss": 0.126,
      "mae_dtheta": 0.03266403079032898,
      "mae_dx": 0.0136749017983675,
      "mae_dy": 0.005502918269485235,
      "pose_mae_dtheta": 0.24331094324588776,
      "pose_mae_dx": 0.10770666599273682,
      "pose_mae_dy": 0.07739900052547455,
      "pose_rmse_dtheta": 0.4402162730693817,
      "pose_rmse_dx": 0.22843915224075317,
      "pose_rmse_dy": 0.2072051614522934,
      "pose_rmse_mean": 0.29195353388786316,
      "rmse_dtheta": 0.05098510906100273,
      "rmse_dx": 0.02625652216374874,
      "rmse_dy": 0.013592644594609737,
      "rmse_mean": 0.030278092250227928,
      "rotation_flip": 0.013402829878032207,
      "sparse_tokens": 23232.0,
      "step": 9658,
      "turn_loss": 0.3199518322944641,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4487548782754135,
      "grad_norm": 0.4593110978603363,
      "learning_rate": 9.286547339991286e-07,
      "loss": 0.0901,
      "mae_dtheta": 0.008156390860676765,
      "mae_dx": 0.0012662297813221812,
      "mae_dy": 0.0013693798100575805,
      "pose_mae_dtheta": 0.05006364360451698,
      "pose_mae_dx": 0.013831204734742641,
      "pose_mae_dy": 0.020452136173844337,
      "pose_rmse_dtheta": 0.11244441568851471,
      "pose_rmse_dx": 0.03342834860086441,
      "pose_rmse_dy": 0.044432319700717926,
      "pose_rmse_mean": 0.06343503296375275,
      "rmse_dtheta": 0.017633182927966118,
      "rmse_dx": 0.004217983689159155,
      "rmse_dy": 0.002579599851742387,
      "rmse_mean": 0.008143588900566101,
      "rotation_flip": 0.007447248790413141,
      "sparse_tokens": 32137.0,
      "step": 9659,
      "turn_loss": 0.0694805458188057,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37963.0,
      "epoch": 0.44880133804125627,
      "grad_norm": 0.4571721851825714,
      "learning_rate": 9.27887344491214e-07,
      "loss": 0.1296,
      "mae_dtheta": 0.034819550812244415,
      "mae_dx": 0.011331728659570217,
      "mae_dy": 0.004696400836110115,
      "pose_mae_dtheta": 0.260271281003952,
      "pose_mae_dx": 0.08852013200521469,
      "pose_mae_dy": 0.05622849985957146,
      "pose_rmse_dtheta": 0.4694402813911438,
      "pose_rmse_dx": 0.1986517459154129,
      "pose_rmse_dy": 0.16282020509243011,
      "pose_rmse_mean": 0.2769707441329956,
      "rmse_dtheta": 0.05366125702857971,
      "rmse_dx": 0.023355403915047646,
      "rmse_dy": 0.010314753279089928,
      "rmse_mean": 0.02911047264933586,
      "rotation_flip": 0.010704224929213524,
      "sparse_tokens": 29434.0,
      "step": 9660,
      "turn_loss": 0.24475130438804626,
      "turns": 117.0,
      "turns_per_sample": 117.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.44884779780709905,
      "grad_norm": 0.5667802095413208,
      "learning_rate": 9.271202397483214e-07,
      "loss": 0.1366,
      "mae_dtheta": 0.03725525364279747,
      "mae_dx": 0.012314208783209324,
      "mae_dy": 0.00417354004457593,
      "pose_mae_dtheta": 0.2938173711299896,
      "pose_mae_dx": 0.0829414650797844,
      "pose_mae_dy": 0.04987087845802307,
      "pose_rmse_dtheta": 0.5297486782073975,
      "pose_rmse_dx": 0.18383637070655823,
      "pose_rmse_dy": 0.11887259781360626,
      "pose_rmse_mean": 0.2774858772754669,
      "rmse_dtheta": 0.05602255091071129,
      "rmse_dx": 0.024049974977970123,
      "rmse_dy": 0.007346262689679861,
      "rmse_mean": 0.029139596968889236,
      "rotation_flip": 0.010266940109431744,
      "sparse_tokens": 8711.0,
      "step": 9661,
      "turn_loss": 0.3039107918739319,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.4488942575729418,
      "grad_norm": 0.7261357307434082,
      "learning_rate": 9.263534198240981e-07,
      "loss": 0.2011,
      "mae_dtheta": 0.03798180818557739,
      "mae_dx": 0.01849742978811264,
      "mae_dy": 0.009667625650763512,
      "pose_mae_dtheta": 0.26972222328186035,
      "pose_mae_dx": 0.13775968551635742,
      "pose_mae_dy": 0.12374446541070938,
      "pose_rmse_dtheta": 0.471173495054245,
      "pose_rmse_dx": 0.2667190730571747,
      "pose_rmse_dy": 0.2247905731201172,
      "pose_rmse_mean": 0.32089439034461975,
      "rmse_dtheta": 0.053721245378255844,
      "rmse_dx": 0.03292091563344002,
      "rmse_dy": 0.014573697000741959,
      "rmse_mean": 0.033738620579242706,
      "rotation_flip": 0.012773722410202026,
      "sparse_tokens": 9637.0,
      "step": 9662,
      "turn_loss": 0.36292779445648193,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 17537.0,
      "epoch": 0.4489407173387846,
      "grad_norm": 1.001926302909851,
      "learning_rate": 9.255868847721655e-07,
      "loss": 0.2199,
      "mae_dtheta": 0.02617461606860161,
      "mae_dx": 0.010237746872007847,
      "mae_dy": 0.002733752131462097,
      "pose_mae_dtheta": 0.19560861587524414,
      "pose_mae_dx": 0.07048195600509644,
      "pose_mae_dy": 0.03496278449892998,
      "pose_rmse_dtheta": 0.40439707040786743,
      "pose_rmse_dx": 0.18191564083099365,
      "pose_rmse_dy": 0.09361916780471802,
      "pose_rmse_mean": 0.22664396464824677,
      "rmse_dtheta": 0.04449523240327835,
      "rmse_dx": 0.023252330720424652,
      "rmse_dy": 0.0053961253724992275,
      "rmse_mean": 0.024381231516599655,
      "rotation_flip": 0.006877579260617495,
      "sparse_tokens": 13972.0,
      "step": 9663,
      "turn_loss": 0.1891379952430725,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.4489871771046274,
      "grad_norm": 0.47345301508903503,
      "learning_rate": 9.248206346461297e-07,
      "loss": 0.1149,
      "mae_dtheta": 0.02527274191379547,
      "mae_dx": 0.009817489422857761,
      "mae_dy": 0.005425539333373308,
      "pose_mae_dtheta": 0.1905348300933838,
      "pose_mae_dx": 0.08773161470890045,
      "pose_mae_dy": 0.07840888202190399,
      "pose_rmse_dtheta": 0.3343223035335541,
      "pose_rmse_dx": 0.22423866391181946,
      "pose_rmse_dy": 0.17208540439605713,
      "pose_rmse_mean": 0.24354879558086395,
      "rmse_dtheta": 0.0396624319255352,
      "rmse_dx": 0.023177802562713623,
      "rmse_dy": 0.01031458005309105,
      "rmse_mean": 0.024384941905736923,
      "rotation_flip": 0.01692708395421505,
      "sparse_tokens": 17576.0,
      "step": 9664,
      "turn_loss": 0.24106158316135406,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 39588.0,
      "epoch": 0.44903363687047015,
      "grad_norm": 0.500156819820404,
      "learning_rate": 9.240546694995733e-07,
      "loss": 0.1171,
      "mae_dtheta": 0.0340927392244339,
      "mae_dx": 0.009601693600416183,
      "mae_dy": 0.004672642797231674,
      "pose_mae_dtheta": 0.24402154982089996,
      "pose_mae_dx": 0.07591869682073593,
      "pose_mae_dy": 0.06076992303133011,
      "pose_rmse_dtheta": 0.43007129430770874,
      "pose_rmse_dx": 0.16651885211467743,
      "pose_rmse_dy": 0.1727885752916336,
      "pose_rmse_mean": 0.2564595937728882,
      "rmse_dtheta": 0.052516911178827286,
      "rmse_dx": 0.020915184170007706,
      "rmse_dy": 0.009806382469832897,
      "rmse_mean": 0.027746159583330154,
      "rotation_flip": 0.011595803312957287,
      "sparse_tokens": 29988.0,
      "step": 9665,
      "turn_loss": 0.2473582774400711,
      "turns": 122.0,
      "turns_per_sample": 122.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.44908009663631293,
      "grad_norm": 0.4816555678844452,
      "learning_rate": 9.232889893860625e-07,
      "loss": 0.1007,
      "mae_dtheta": 0.010901262983679771,
      "mae_dx": 0.001588827813975513,
      "mae_dy": 0.0024923146702349186,
      "pose_mae_dtheta": 0.06784224510192871,
      "pose_mae_dx": 0.0224442221224308,
      "pose_mae_dy": 0.030119597911834717,
      "pose_rmse_dtheta": 0.1336534470319748,
      "pose_rmse_dx": 0.054873205721378326,
      "pose_rmse_dy": 0.05954691022634506,
      "pose_rmse_mean": 0.08269119262695312,
      "rmse_dtheta": 0.02070923149585724,
      "rmse_dx": 0.005180822219699621,
      "rmse_dy": 0.00484238239005208,
      "rmse_mean": 0.01024414598941803,
      "rotation_flip": 0.003655699547380209,
      "sparse_tokens": 32105.0,
      "step": 9666,
      "turn_loss": 0.08834104984998703,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4491265564021557,
      "grad_norm": 0.39039352536201477,
      "learning_rate": 9.225235943591398e-07,
      "loss": 0.0805,
      "mae_dtheta": 0.007656566798686981,
      "mae_dx": 0.0012760104145854712,
      "mae_dy": 0.0017637059791013598,
      "pose_mae_dtheta": 0.05214696750044823,
      "pose_mae_dx": 0.014691203832626343,
      "pose_mae_dy": 0.020732516422867775,
      "pose_rmse_dtheta": 0.11578311771154404,
      "pose_rmse_dx": 0.04266282916069031,
      "pose_rmse_dy": 0.047557711601257324,
      "pose_rmse_mean": 0.06866788864135742,
      "rmse_dtheta": 0.01640995778143406,
      "rmse_dx": 0.0039999596774578094,
      "rmse_dy": 0.00398531137034297,
      "rmse_mean": 0.008131743408739567,
      "rotation_flip": 0.006415740121155977,
      "sparse_tokens": 32089.0,
      "step": 9667,
      "turn_loss": 0.06351552158594131,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.44917301616799854,
      "grad_norm": 0.5101102590560913,
      "learning_rate": 9.217584844723315e-07,
      "loss": 0.1012,
      "mae_dtheta": 0.00980309583246708,
      "mae_dx": 0.002297696191817522,
      "mae_dy": 0.0035230033099651337,
      "pose_mae_dtheta": 0.0702863335609436,
      "pose_mae_dx": 0.025379959493875504,
      "pose_mae_dy": 0.030784135684370995,
      "pose_rmse_dtheta": 0.19010041654109955,
      "pose_rmse_dx": 0.07826731353998184,
      "pose_rmse_dy": 0.08144490420818329,
      "pose_rmse_mean": 0.11660420894622803,
      "rmse_dtheta": 0.02369624562561512,
      "rmse_dx": 0.0071524763479828835,
      "rmse_dy": 0.009099381044507027,
      "rmse_mean": 0.013316035270690918,
      "rotation_flip": 0.004814004525542259,
      "sparse_tokens": 32073.0,
      "step": 9668,
      "turn_loss": 0.102562814950943,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.4492194759338413,
      "grad_norm": 0.8458234667778015,
      "learning_rate": 9.209936597791407e-07,
      "loss": 0.2619,
      "mae_dtheta": 0.02361551858484745,
      "mae_dx": 0.010537414811551571,
      "mae_dy": 0.003533758455887437,
      "pose_mae_dtheta": 0.18873412907123566,
      "pose_mae_dx": 0.08562559634447098,
      "pose_mae_dy": 0.0461541973054409,
      "pose_rmse_dtheta": 0.35597366094589233,
      "pose_rmse_dx": 0.19395774602890015,
      "pose_rmse_dy": 0.11221995949745178,
      "pose_rmse_mean": 0.22071711719036102,
      "rmse_dtheta": 0.039638835936784744,
      "rmse_dx": 0.022390402853488922,
      "rmse_dy": 0.006632532458752394,
      "rmse_mean": 0.022887257859110832,
      "rotation_flip": 0.011600928381085396,
      "sparse_tokens": 9309.0,
      "step": 9669,
      "turn_loss": 0.17190702259540558,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.4492659356996841,
      "grad_norm": 0.49332231283187866,
      "learning_rate": 9.202291203330522e-07,
      "loss": 0.1251,
      "mae_dtheta": 0.03444119915366173,
      "mae_dx": 0.01050768606364727,
      "mae_dy": 0.007602608297020197,
      "pose_mae_dtheta": 0.2473347783088684,
      "pose_mae_dx": 0.08014890551567078,
      "pose_mae_dy": 0.08337517827749252,
      "pose_rmse_dtheta": 0.46375390887260437,
      "pose_rmse_dx": 0.17674213647842407,
      "pose_rmse_dy": 0.18536260724067688,
      "pose_rmse_mean": 0.2752861976623535,
      "rmse_dtheta": 0.05350822955369949,
      "rmse_dx": 0.022640176117420197,
      "rmse_dy": 0.015668319538235664,
      "rmse_mean": 0.030605575069785118,
      "rotation_flip": 0.014840182848274708,
      "sparse_tokens": 15929.0,
      "step": 9670,
      "turn_loss": 0.31729480624198914,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.44931239546552687,
      "grad_norm": 0.39778590202331543,
      "learning_rate": 9.194648661875322e-07,
      "loss": 0.1349,
      "mae_dtheta": 0.03966015204787254,
      "mae_dx": 0.013771941885352135,
      "mae_dy": 0.0055965702049434185,
      "pose_mae_dtheta": 0.2902071475982666,
      "pose_mae_dx": 0.1097683310508728,
      "pose_mae_dy": 0.06708472967147827,
      "pose_rmse_dtheta": 0.5263819694519043,
      "pose_rmse_dx": 0.24099424481391907,
      "pose_rmse_dy": 0.14587649703025818,
      "pose_rmse_mean": 0.30441758036613464,
      "rmse_dtheta": 0.058625735342502594,
      "rmse_dx": 0.026764485985040665,
      "rmse_dy": 0.010576490312814713,
      "rmse_mean": 0.031988903880119324,
      "rotation_flip": 0.014665444381535053,
      "sparse_tokens": 17279.0,
      "step": 9671,
      "turn_loss": 0.3027692139148712,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.44935885523136965,
      "grad_norm": 0.4077831208705902,
      "learning_rate": 9.187008973960232e-07,
      "loss": 0.0973,
      "mae_dtheta": 0.008487443439662457,
      "mae_dx": 0.0012156851589679718,
      "mae_dy": 0.0013445683289319277,
      "pose_mae_dtheta": 0.055452052503824234,
      "pose_mae_dx": 0.01267958153039217,
      "pose_mae_dy": 0.01643197052180767,
      "pose_rmse_dtheta": 0.15714509785175323,
      "pose_rmse_dx": 0.03466459736227989,
      "pose_rmse_dy": 0.04600663110613823,
      "pose_rmse_mean": 0.07927211374044418,
      "rmse_dtheta": 0.022907398641109467,
      "rmse_dx": 0.00431620329618454,
      "rmse_dy": 0.004024271387606859,
      "rmse_mean": 0.010415958240628242,
      "rotation_flip": 0.005885500460863113,
      "sparse_tokens": 32073.0,
      "step": 9672,
      "turn_loss": 0.06370723992586136,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.4494053149972124,
      "grad_norm": 0.7120891213417053,
      "learning_rate": 9.179372140119524e-07,
      "loss": 0.2006,
      "mae_dtheta": 0.03607209026813507,
      "mae_dx": 0.008608751930296421,
      "mae_dy": 0.004297445062547922,
      "pose_mae_dtheta": 0.28628942370414734,
      "pose_mae_dx": 0.05773488059639931,
      "pose_mae_dy": 0.03676028177142143,
      "pose_rmse_dtheta": 0.5387324094772339,
      "pose_rmse_dx": 0.12595847249031067,
      "pose_rmse_dy": 0.11670901626348495,
      "pose_rmse_mean": 0.26046663522720337,
      "rmse_dtheta": 0.05719375982880592,
      "rmse_dx": 0.0182956513017416,
      "rmse_dy": 0.010182132944464684,
      "rmse_mean": 0.028557181358337402,
      "rotation_flip": 0.010378058068454266,
      "sparse_tokens": 22507.0,
      "step": 9673,
      "turn_loss": 0.2443699836730957,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 9731.0,
      "epoch": 0.4494517747630552,
      "grad_norm": 0.6812703013420105,
      "learning_rate": 9.171738160887217e-07,
      "loss": 0.1373,
      "mae_dtheta": 0.036927368491888046,
      "mae_dx": 0.012622752226889133,
      "mae_dy": 0.0023049002047628164,
      "pose_mae_dtheta": 0.28624483942985535,
      "pose_mae_dx": 0.10263464599847794,
      "pose_mae_dy": 0.028382161632180214,
      "pose_rmse_dtheta": 0.493365615606308,
      "pose_rmse_dx": 0.22216251492500305,
      "pose_rmse_dy": 0.06099372357130051,
      "pose_rmse_mean": 0.2588406205177307,
      "rmse_dtheta": 0.053960833698511124,
      "rmse_dx": 0.023440049961209297,
      "rmse_dy": 0.0048332191072404385,
      "rmse_mean": 0.02741136960685253,
      "rotation_flip": 0.009367681108415127,
      "sparse_tokens": 7371.0,
      "step": 9674,
      "turn_loss": 0.21023239195346832,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.449498234528898,
      "grad_norm": 0.49569767713546753,
      "learning_rate": 9.164107036797177e-07,
      "loss": 0.1563,
      "mae_dtheta": 0.0356641449034214,
      "mae_dx": 0.011446090415120125,
      "mae_dy": 0.004663970787078142,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.49569761753082275,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.41873168945312,
      "model/head/act_norm_mean": 103.6207950367647,
      "model/head/act_norm_min": 69.6470947265625,
      "model/head/act_over_embed": 71.20918046243222,
      "model/head/grad_frac": 0.12840761244297028,
      "model/head/grad_norm": 0.06365134567022324,
      "model/head/grad_zero_frac": 0.00014721410116180778,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6967715992647059,
      "model/head/update_ratio": 0.0010836877627298236,
      "model/head/weight_delta": 9.926587104797363,
      "model/head/weight_delta_rel": 0.17414173483848572,
      "model/head/weight_norm": 58.73587417602539,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42269811034202576,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42269811034202576,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42269811034202576,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29048209878909836,
      "model/modality_embedder.encoders.pose/grad_frac": 0.030802404507994652,
      "model/modality_embedder.encoders.pose/grad_norm": 0.015268678776919842,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0004930229624733329,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1427524089813232,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10268351435661316,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96950912475586,
      "model/modality_embedder/grad_frac": 0.030802404507994652,
      "model/modality_embedder/grad_norm": 0.015268678776919842,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0004930229624733329,
      "model/modality_embedder/weight_delta": 3.1427524089813232,
      "model/modality_embedder/weight_delta_rel": 0.10268351435661316,
      "model/modality_embedder/weight_norm": 30.96950912475586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 76.27725219726562,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.989965569561157,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.261938095092773,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.79891957485118,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09520722925662994,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.047193996608257294,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016882626805454493,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.711137056350708,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09879547357559204,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.954177856445312,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 77.5336685180664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.753806314192342,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.559599876403809,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.32383808575145,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08085781335830688,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.040081024169921875,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013468296965584159,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4376072883605957,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11908140033483505,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.759532928466797,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.06010437011719,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.31141748366013,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.570505142211914,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.394243063995233,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07989736646413803,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03960493579506874,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012887995690107346,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.722330331802368,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12498888373374939,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.7300968170166,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.18269348144531,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.162899743230625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.467912673950195,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.666599006622093,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06280765682458878,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.031133605167269707,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010396601865068078,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.197129726409912,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10926271975040436,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.945941925048828,
      "model/normalizer/grad_frac": 0.2807444632053375,
      "model/normalizer/grad_norm": 0.13916435837745667,
      "model/normalizer/grad_zero_frac": 0.00018435118545312434,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0017695223214104772,
      "model/normalizer/weight_delta": 6.729066371917725,
      "model/normalizer/weight_delta_rel": 0.08666647970676422,
      "model/normalizer/weight_norm": 78.64515686035156,
      "pose_mae_dtheta": 0.2726712226867676,
      "pose_mae_dx": 0.09495875239372253,
      "pose_mae_dy": 0.06832239031791687,
      "pose_rmse_dtheta": 0.43898966908454895,
      "pose_rmse_dx": 0.2156907469034195,
      "pose_rmse_dy": 0.1538001000881195,
      "pose_rmse_mean": 0.2694935202598572,
      "rmse_dtheta": 0.04937449097633362,
      "rmse_dx": 0.024303944781422615,
      "rmse_dy": 0.008804748766124249,
      "rmse_mean": 0.027494393289089203,
      "rotation_flip": 0.01049233227968216,
      "sparse_tokens": 21197.0,
      "step": 9675,
      "turn_loss": 0.2687384784221649,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.44954469429474075,
      "grad_norm": 0.41963785886764526,
      "learning_rate": 9.15647876838306e-07,
      "loss": 0.0996,
      "mae_dtheta": 0.029443873092532158,
      "mae_dx": 0.012105339206755161,
      "mae_dy": 0.005688873585313559,
      "pose_mae_dtheta": 0.23902162909507751,
      "pose_mae_dx": 0.12595905363559723,
      "pose_mae_dy": 0.09595941007137299,
      "pose_rmse_dtheta": 0.41173672676086426,
      "pose_rmse_dx": 0.27286139130592346,
      "pose_rmse_dy": 0.18466374278068542,
      "pose_rmse_mean": 0.2897539734840393,
      "rmse_dtheta": 0.042867712676525116,
      "rmse_dx": 0.02665013261139393,
      "rmse_dy": 0.009982067160308361,
      "rmse_mean": 0.026499969884753227,
      "rotation_flip": 0.016233766451478004,
      "sparse_tokens": 4731.0,
      "step": 9676,
      "turn_loss": 0.25208353996276855,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.44959115406058353,
      "grad_norm": 0.500250518321991,
      "learning_rate": 9.148853356178294e-07,
      "loss": 0.0788,
      "mae_dtheta": 0.005155807361006737,
      "mae_dx": 0.0010278436820954084,
      "mae_dy": 0.0012409468181431293,
      "pose_mae_dtheta": 0.037195492535829544,
      "pose_mae_dx": 0.01186464074999094,
      "pose_mae_dy": 0.01451861672103405,
      "pose_rmse_dtheta": 0.0983356237411499,
      "pose_rmse_dx": 0.034146059304475784,
      "pose_rmse_dy": 0.04431672394275665,
      "pose_rmse_mean": 0.05893280357122421,
      "rmse_dtheta": 0.013924096710979939,
      "rmse_dx": 0.003297536401078105,
      "rmse_dy": 0.0036591840907931328,
      "rmse_mean": 0.006960272789001465,
      "rotation_flip": 0.008255934342741966,
      "sparse_tokens": 32089.0,
      "step": 9677,
      "turn_loss": 0.04601043462753296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4496376138264263,
      "grad_norm": 0.565608561038971,
      "learning_rate": 9.14123080071615e-07,
      "loss": 0.1402,
      "mae_dtheta": 0.012108933180570602,
      "mae_dx": 0.0020913337357342243,
      "mae_dy": 0.0028816761914640665,
      "pose_mae_dtheta": 0.07433462142944336,
      "pose_mae_dx": 0.023690301924943924,
      "pose_mae_dy": 0.033975329250097275,
      "pose_rmse_dtheta": 0.17565315961837769,
      "pose_rmse_dx": 0.07334645092487335,
      "pose_rmse_dy": 0.07907459139823914,
      "pose_rmse_mean": 0.10935807228088379,
      "rmse_dtheta": 0.02323264069855213,
      "rmse_dx": 0.007107830606400967,
      "rmse_dy": 0.007064939476549625,
      "rmse_mean": 0.012468470260500908,
      "rotation_flip": 0.012163656763732433,
      "sparse_tokens": 32105.0,
      "step": 9678,
      "turn_loss": 0.09918016195297241,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4496840735922691,
      "grad_norm": 0.3811211585998535,
      "learning_rate": 9.133611102529655e-07,
      "loss": 0.0953,
      "mae_dtheta": 0.012177292257547379,
      "mae_dx": 0.0016769900685176253,
      "mae_dy": 0.0028928117826581,
      "pose_mae_dtheta": 0.07463401556015015,
      "pose_mae_dx": 0.025830591097474098,
      "pose_mae_dy": 0.03288080915808678,
      "pose_rmse_dtheta": 0.18133805692195892,
      "pose_rmse_dx": 0.06082542985677719,
      "pose_rmse_dy": 0.06815720349550247,
      "pose_rmse_mean": 0.10344022512435913,
      "rmse_dtheta": 0.023669637739658356,
      "rmse_dx": 0.004584787413477898,
      "rmse_dy": 0.005746445618569851,
      "rmse_mean": 0.01133362390100956,
      "rotation_flip": 0.0031938678584992886,
      "sparse_tokens": 32105.0,
      "step": 9679,
      "turn_loss": 0.09373795241117477,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.44973053335811186,
      "grad_norm": 0.5312502384185791,
      "learning_rate": 9.125994262151683e-07,
      "loss": 0.062,
      "mae_dtheta": 0.007856864482164383,
      "mae_dx": 0.0016891630366444588,
      "mae_dy": 0.0019189146114513278,
      "pose_mae_dtheta": 0.0486908033490181,
      "pose_mae_dx": 0.01851184479892254,
      "pose_mae_dy": 0.01843416877090931,
      "pose_rmse_dtheta": 0.12955555319786072,
      "pose_rmse_dx": 0.05301228165626526,
      "pose_rmse_dy": 0.04236385598778725,
      "pose_rmse_mean": 0.07497723400592804,
      "rmse_dtheta": 0.018877165392041206,
      "rmse_dx": 0.006611586082726717,
      "rmse_dy": 0.004801300819963217,
      "rmse_mean": 0.010096684098243713,
      "rotation_flip": 0.0020333467982709408,
      "sparse_tokens": 32089.0,
      "step": 9680,
      "turn_loss": 0.06535213440656662,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.44977699312395464,
      "grad_norm": 0.5407730340957642,
      "learning_rate": 9.118380280114858e-07,
      "loss": 0.1319,
      "mae_dtheta": 0.008650444447994232,
      "mae_dx": 0.0008073887438513339,
      "mae_dy": 0.0013486986281350255,
      "pose_mae_dtheta": 0.05800860747694969,
      "pose_mae_dx": 0.012367838062345982,
      "pose_mae_dy": 0.019354425370693207,
      "pose_rmse_dtheta": 0.18415126204490662,
      "pose_rmse_dx": 0.03483443707227707,
      "pose_rmse_dy": 0.04381553828716278,
      "pose_rmse_mean": 0.08760040998458862,
      "rmse_dtheta": 0.02170109748840332,
      "rmse_dx": 0.002766693476587534,
      "rmse_dy": 0.0027494700625538826,
      "rmse_mean": 0.009072421118617058,
      "rotation_flip": 0.006413192953914404,
      "sparse_tokens": 32041.0,
      "step": 9681,
      "turn_loss": 0.047319646924734116,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 38938.0,
      "epoch": 0.4498234528897974,
      "grad_norm": 0.6858291029930115,
      "learning_rate": 9.110769156951638e-07,
      "loss": 0.1463,
      "mae_dtheta": 0.04348955303430557,
      "mae_dx": 0.010528488084673882,
      "mae_dy": 0.003966033924371004,
      "pose_mae_dtheta": 0.3428976833820343,
      "pose_mae_dx": 0.07942429929971695,
      "pose_mae_dy": 0.04279047250747681,
      "pose_rmse_dtheta": 0.5602794885635376,
      "pose_rmse_dx": 0.1658591777086258,
      "pose_rmse_dy": 0.11492566019296646,
      "pose_rmse_mean": 0.2803547978401184,
      "rmse_dtheta": 0.06122245267033577,
      "rmse_dx": 0.021236484870314598,
      "rmse_dy": 0.010018276050686836,
      "rmse_mean": 0.030825737863779068,
      "rotation_flip": 0.011038634926080704,
      "sparse_tokens": 28108.0,
      "step": 9682,
      "turn_loss": 0.31256622076034546,
      "turns": 120.0,
      "turns_per_sample": 120.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4498699126556402,
      "grad_norm": 0.7579641342163086,
      "learning_rate": 9.103160893194296e-07,
      "loss": 0.1546,
      "mae_dtheta": 0.011824534274637699,
      "mae_dx": 0.00467719929292798,
      "mae_dy": 0.002233467996120453,
      "pose_mae_dtheta": 0.08441676944494247,
      "pose_mae_dx": 0.04804117605090141,
      "pose_mae_dy": 0.02661064639687538,
      "pose_rmse_dtheta": 0.23668237030506134,
      "pose_rmse_dx": 0.1366264969110489,
      "pose_rmse_dy": 0.07387730479240417,
      "pose_rmse_mean": 0.14906206727027893,
      "rmse_dtheta": 0.02821224182844162,
      "rmse_dx": 0.013732719235122204,
      "rmse_dy": 0.006187118589878082,
      "rmse_mean": 0.016044028103351593,
      "rotation_flip": 0.003848268184810877,
      "sparse_tokens": 32105.0,
      "step": 9683,
      "turn_loss": 0.10395152866840363,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15267.0,
      "epoch": 0.44991637242148297,
      "grad_norm": 0.41065582633018494,
      "learning_rate": 9.095555489374847e-07,
      "loss": 0.0938,
      "mae_dtheta": 0.035590264946222305,
      "mae_dx": 0.012710217386484146,
      "mae_dy": 0.005592965986579657,
      "pose_mae_dtheta": 0.2649787962436676,
      "pose_mae_dx": 0.10436346381902695,
      "pose_mae_dy": 0.06987236440181732,
      "pose_rmse_dtheta": 0.46802783012390137,
      "pose_rmse_dx": 0.22805505990982056,
      "pose_rmse_dy": 0.14902323484420776,
      "pose_rmse_mean": 0.28170204162597656,
      "rmse_dtheta": 0.05448279157280922,
      "rmse_dx": 0.026039205491542816,
      "rmse_dy": 0.010138962417840958,
      "rmse_mean": 0.03022032044827938,
      "rotation_flip": 0.013615733943879604,
      "sparse_tokens": 12089.0,
      "step": 9684,
      "turn_loss": 0.30258169770240784,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.4499628321873258,
      "grad_norm": 0.5435242652893066,
      "learning_rate": 9.087952946025175e-07,
      "loss": 0.1046,
      "mae_dtheta": 0.0518278107047081,
      "mae_dx": 0.011783014051616192,
      "mae_dy": 0.00367659330368042,
      "pose_mae_dtheta": 0.4416448771953583,
      "pose_mae_dx": 0.09579112380743027,
      "pose_mae_dy": 0.045154597610235214,
      "pose_rmse_dtheta": 0.7366958856582642,
      "pose_rmse_dx": 0.21009181439876556,
      "pose_rmse_dy": 0.11290030926465988,
      "pose_rmse_mean": 0.3532293438911438,
      "rmse_dtheta": 0.07297879457473755,
      "rmse_dx": 0.023577621206641197,
      "rmse_dy": 0.008098774589598179,
      "rmse_mean": 0.034885063767433167,
      "rotation_flip": 0.009433962404727936,
      "sparse_tokens": 6990.0,
      "step": 9685,
      "turn_loss": 0.27422240376472473,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.4500092919531686,
      "grad_norm": 0.484121173620224,
      "learning_rate": 9.080353263676894e-07,
      "loss": 0.1117,
      "mae_dtheta": 0.032100021839141846,
      "mae_dx": 0.01188936922699213,
      "mae_dy": 0.004579194355756044,
      "pose_mae_dtheta": 0.24245327711105347,
      "pose_mae_dx": 0.1066608652472496,
      "pose_mae_dy": 0.05801847204566002,
      "pose_rmse_dtheta": 0.4363952577114105,
      "pose_rmse_dx": 0.2463870495557785,
      "pose_rmse_dy": 0.125380739569664,
      "pose_rmse_mean": 0.26938769221305847,
      "rmse_dtheta": 0.049557629972696304,
      "rmse_dx": 0.025047359988093376,
      "rmse_dy": 0.008291094563901424,
      "rmse_mean": 0.027632027864456177,
      "rotation_flip": 0.009960159659385681,
      "sparse_tokens": 26325.0,
      "step": 9686,
      "turn_loss": 0.21682067215442657,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 29108.0,
      "epoch": 0.45005575171901135,
      "grad_norm": 0.4927992522716522,
      "learning_rate": 9.072756442861485e-07,
      "loss": 0.1495,
      "mae_dtheta": 0.026276400312781334,
      "mae_dx": 0.01085746567696333,
      "mae_dy": 0.004391446243971586,
      "pose_mae_dtheta": 0.21106237173080444,
      "pose_mae_dx": 0.08993350714445114,
      "pose_mae_dy": 0.06196409836411476,
      "pose_rmse_dtheta": 0.38390758633613586,
      "pose_rmse_dx": 0.2184666395187378,
      "pose_rmse_dy": 0.12906071543693542,
      "pose_rmse_mean": 0.24381165206432343,
      "rmse_dtheta": 0.041787039488554,
      "rmse_dx": 0.02358277328312397,
      "rmse_dy": 0.007638253271579742,
      "rmse_mean": 0.02433602325618267,
      "rotation_flip": 0.022310756146907806,
      "sparse_tokens": 22845.0,
      "step": 9687,
      "turn_loss": 0.176376074552536,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.45010221148485413,
      "grad_norm": 0.4805253744125366,
      "learning_rate": 9.06516248411018e-07,
      "loss": 0.1091,
      "mae_dtheta": 0.02839440293610096,
      "mae_dx": 0.010664320550858974,
      "mae_dy": 0.0037457516882568598,
      "pose_mae_dtheta": 0.24711723625659943,
      "pose_mae_dx": 0.07450015097856522,
      "pose_mae_dy": 0.051578570157289505,
      "pose_rmse_dtheta": 0.4705660343170166,
      "pose_rmse_dx": 0.17420142889022827,
      "pose_rmse_dy": 0.11651910096406937,
      "pose_rmse_mean": 0.2537621855735779,
      "rmse_dtheta": 0.04839685559272766,
      "rmse_dx": 0.02280219830572605,
      "rmse_dy": 0.007228553760796785,
      "rmse_mean": 0.026142535731196404,
      "rotation_flip": 0.008620689623057842,
      "sparse_tokens": 9199.0,
      "step": 9688,
      "turn_loss": 0.19406941533088684,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.4501486712506969,
      "grad_norm": 0.5074343681335449,
      "learning_rate": 9.057571387954023e-07,
      "loss": 0.1039,
      "mae_dtheta": 0.03306526690721512,
      "mae_dx": 0.00889122486114502,
      "mae_dy": 0.01304208766669035,
      "pose_mae_dtheta": 0.22415457665920258,
      "pose_mae_dx": 0.1120409145951271,
      "pose_mae_dy": 0.10516756772994995,
      "pose_rmse_dtheta": 0.42614877223968506,
      "pose_rmse_dx": 0.24926309287548065,
      "pose_rmse_dy": 0.2540113627910614,
      "pose_rmse_mean": 0.30980774760246277,
      "rmse_dtheta": 0.04932697117328644,
      "rmse_dx": 0.01785833202302456,
      "rmse_dy": 0.02544366754591465,
      "rmse_mean": 0.030876323580741882,
      "rotation_flip": 0.007092198356986046,
      "sparse_tokens": 4452.0,
      "step": 9689,
      "turn_loss": 0.44077423214912415,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.4501951310165397,
      "grad_norm": 0.4830896258354187,
      "learning_rate": 9.049983154923892e-07,
      "loss": 0.1012,
      "mae_dtheta": 0.030979178845882416,
      "mae_dx": 0.015247989445924759,
      "mae_dy": 0.007008287589997053,
      "pose_mae_dtheta": 0.22497786581516266,
      "pose_mae_dx": 0.1314152330160141,
      "pose_mae_dy": 0.09476028382778168,
      "pose_rmse_dtheta": 0.3884938359260559,
      "pose_rmse_dx": 0.30467313528060913,
      "pose_rmse_dy": 0.20794902741909027,
      "pose_rmse_mean": 0.30037200450897217,
      "rmse_dtheta": 0.04626334831118584,
      "rmse_dx": 0.02997179888188839,
      "rmse_dy": 0.014277382753789425,
      "rmse_mean": 0.03017084300518036,
      "rotation_flip": 0.011647254228591919,
      "sparse_tokens": 24102.0,
      "step": 9690,
      "turn_loss": 0.3044947683811188,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.45024159078238246,
      "grad_norm": 0.4310401380062103,
      "learning_rate": 9.042397785550405e-07,
      "loss": 0.1046,
      "mae_dtheta": 0.009228191338479519,
      "mae_dx": 0.001246035099029541,
      "mae_dy": 0.0016194210620597005,
      "pose_mae_dtheta": 0.060739681124687195,
      "pose_mae_dx": 0.014385859481990337,
      "pose_mae_dy": 0.022891314700245857,
      "pose_rmse_dtheta": 0.17650949954986572,
      "pose_rmse_dx": 0.03679754585027695,
      "pose_rmse_dy": 0.05249428004026413,
      "pose_rmse_mean": 0.08860044926404953,
      "rmse_dtheta": 0.022500334307551384,
      "rmse_dx": 0.0042487154714763165,
      "rmse_dy": 0.003473883494734764,
      "rmse_mean": 0.0100743118673563,
      "rotation_flip": 0.0060658580623567104,
      "sparse_tokens": 32057.0,
      "step": 9691,
      "turn_loss": 0.07846321910619736,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.45028805054822524,
      "grad_norm": 0.5652545690536499,
      "learning_rate": 9.03481528036404e-07,
      "loss": 0.109,
      "mae_dtheta": 0.00763933127745986,
      "mae_dx": 0.001190159353427589,
      "mae_dy": 0.0017577685648575425,
      "pose_mae_dtheta": 0.050876930356025696,
      "pose_mae_dx": 0.017272111028432846,
      "pose_mae_dy": 0.024053456261754036,
      "pose_rmse_dtheta": 0.11052516847848892,
      "pose_rmse_dx": 0.04986893758177757,
      "pose_rmse_dy": 0.062182776629924774,
      "pose_rmse_mean": 0.07419230043888092,
      "rmse_dtheta": 0.01612091064453125,
      "rmse_dx": 0.004023720044642687,
      "rmse_dy": 0.004508041776716709,
      "rmse_mean": 0.008217557333409786,
      "rotation_flip": 0.0032725571654736996,
      "sparse_tokens": 32057.0,
      "step": 9692,
      "turn_loss": 0.054125189781188965,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.450334510314068,
      "grad_norm": 0.7334674000740051,
      "learning_rate": 9.027235639895015e-07,
      "loss": 0.1552,
      "mae_dtheta": 0.02723439410328865,
      "mae_dx": 0.012609316036105156,
      "mae_dy": 0.005095840897411108,
      "pose_mae_dtheta": 0.196884885430336,
      "pose_mae_dx": 0.10134802758693695,
      "pose_mae_dy": 0.07754836231470108,
      "pose_rmse_dtheta": 0.376312255859375,
      "pose_rmse_dx": 0.24448974430561066,
      "pose_rmse_dy": 0.17580853402614594,
      "pose_rmse_mean": 0.2655368447303772,
      "rmse_dtheta": 0.04473790153861046,
      "rmse_dx": 0.027055978775024414,
      "rmse_dy": 0.00931547675281763,
      "rmse_mean": 0.027036454528570175,
      "rotation_flip": 0.004640371073037386,
      "sparse_tokens": 7424.0,
      "step": 9693,
      "turn_loss": 0.16709688305854797,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.4503809700799108,
      "grad_norm": 0.6799242496490479,
      "learning_rate": 9.019658864673403e-07,
      "loss": 0.1698,
      "mae_dtheta": 0.036573875695466995,
      "mae_dx": 0.019282478839159012,
      "mae_dy": 0.008194575086236,
      "pose_mae_dtheta": 0.24398095905780792,
      "pose_mae_dx": 0.13670577108860016,
      "pose_mae_dy": 0.1110619530081749,
      "pose_rmse_dtheta": 0.3798709213733673,
      "pose_rmse_dx": 0.2987581193447113,
      "pose_rmse_dy": 0.21977078914642334,
      "pose_rmse_mean": 0.299466609954834,
      "rmse_dtheta": 0.04970264434814453,
      "rmse_dx": 0.03369449824094772,
      "rmse_dy": 0.012734944932162762,
      "rmse_mean": 0.03204403072595596,
      "rotation_flip": 0.015625,
      "sparse_tokens": 5306.0,
      "step": 9694,
      "turn_loss": 0.31970667839050293,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.45042742984575357,
      "grad_norm": 0.3383787274360657,
      "learning_rate": 9.012084955229034e-07,
      "loss": 0.083,
      "mae_dtheta": 0.03673843294382095,
      "mae_dx": 0.011661969125270844,
      "mae_dy": 0.005278576165437698,
      "pose_mae_dtheta": 0.30296751856803894,
      "pose_mae_dx": 0.09136815369129181,
      "pose_mae_dy": 0.0736740306019783,
      "pose_rmse_dtheta": 0.5109807252883911,
      "pose_rmse_dx": 0.20393481850624084,
      "pose_rmse_dy": 0.17428423464298248,
      "pose_rmse_mean": 0.29639992117881775,
      "rmse_dtheta": 0.05355006456375122,
      "rmse_dx": 0.02415977232158184,
      "rmse_dy": 0.009489202871918678,
      "rmse_mean": 0.02906634658575058,
      "rotation_flip": 0.013492063619196415,
      "sparse_tokens": 20137.0,
      "step": 9695,
      "turn_loss": 0.24734888970851898,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.45047388961159635,
      "grad_norm": 0.7299757599830627,
      "learning_rate": 9.004513912091573e-07,
      "loss": 0.1611,
      "mae_dtheta": 0.008394673466682434,
      "mae_dx": 0.0013497215695679188,
      "mae_dy": 0.0022800180595368147,
      "pose_mae_dtheta": 0.05272500216960907,
      "pose_mae_dx": 0.020064203068614006,
      "pose_mae_dy": 0.021154893562197685,
      "pose_rmse_dtheta": 0.1368357390165329,
      "pose_rmse_dx": 0.062402158975601196,
      "pose_rmse_dy": 0.05479678511619568,
      "pose_rmse_mean": 0.08467823266983032,
      "rmse_dtheta": 0.020507648587226868,
      "rmse_dx": 0.0034680375829339027,
      "rmse_dy": 0.005490384995937347,
      "rmse_mean": 0.009822024032473564,
      "rotation_flip": 0.0018467220943421125,
      "sparse_tokens": 32073.0,
      "step": 9696,
      "turn_loss": 0.060120243579149246,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.4505203493774391,
      "grad_norm": 0.5577275156974792,
      "learning_rate": 8.996945735790447e-07,
      "loss": 0.0647,
      "mae_dtheta": 0.04291244596242905,
      "mae_dx": 0.0241647157818079,
      "mae_dy": 0.012249668128788471,
      "pose_mae_dtheta": 0.28098490834236145,
      "pose_mae_dx": 0.20051702857017517,
      "pose_mae_dy": 0.12277644872665405,
      "pose_rmse_dtheta": 0.42964425683021545,
      "pose_rmse_dx": 0.34199342131614685,
      "pose_rmse_dy": 0.19868609309196472,
      "pose_rmse_mean": 0.3234412670135498,
      "rmse_dtheta": 0.056916698813438416,
      "rmse_dx": 0.03763587400317192,
      "rmse_dy": 0.021469486877322197,
      "rmse_mean": 0.03867402300238609,
      "rotation_flip": 0.0,
      "sparse_tokens": 4882.0,
      "step": 9697,
      "turn_loss": 0.39167043566703796,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4505668091432819,
      "grad_norm": 0.2891688346862793,
      "learning_rate": 8.989380426854927e-07,
      "loss": 0.0561,
      "mae_dtheta": 0.0055125681683421135,
      "mae_dx": 0.0008760917116887867,
      "mae_dy": 0.0009397183894179761,
      "pose_mae_dtheta": 0.040126774460077286,
      "pose_mae_dx": 0.010380708612501621,
      "pose_mae_dy": 0.013774052262306213,
      "pose_rmse_dtheta": 0.14975930750370026,
      "pose_rmse_dx": 0.026008306071162224,
      "pose_rmse_dy": 0.03622713312506676,
      "pose_rmse_mean": 0.0706649199128151,
      "rmse_dtheta": 0.01681603491306305,
      "rmse_dx": 0.002739804331213236,
      "rmse_dy": 0.0020974064245820045,
      "rmse_mean": 0.007217749021947384,
      "rotation_flip": 0.0014591439394280314,
      "sparse_tokens": 32105.0,
      "step": 9698,
      "turn_loss": 0.03567338362336159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22326.0,
      "epoch": 0.4506132689091247,
      "grad_norm": 0.40309908986091614,
      "learning_rate": 8.981817985814029e-07,
      "loss": 0.1052,
      "mae_dtheta": 0.02681989222764969,
      "mae_dx": 0.010746065527200699,
      "mae_dy": 0.004488521255552769,
      "pose_mae_dtheta": 0.20351196825504303,
      "pose_mae_dx": 0.08640491217374802,
      "pose_mae_dy": 0.07144439220428467,
      "pose_rmse_dtheta": 0.3612622916698456,
      "pose_rmse_dx": 0.19345298409461975,
      "pose_rmse_dy": 0.16860398650169373,
      "pose_rmse_mean": 0.24110643565654755,
      "rmse_dtheta": 0.043750740587711334,
      "rmse_dx": 0.02315560169517994,
      "rmse_dy": 0.009948721155524254,
      "rmse_mean": 0.025618355721235275,
      "rotation_flip": 0.008138352073729038,
      "sparse_tokens": 18113.0,
      "step": 9699,
      "turn_loss": 0.2257709950208664,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.45065972867496745,
      "grad_norm": 0.4819154441356659,
      "learning_rate": 8.974258413196629e-07,
      "loss": 0.1178,
      "mae_dtheta": 0.008860142901539803,
      "mae_dx": 0.0012691174633800983,
      "mae_dy": 0.0019329044735059142,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.48191550374031067,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.6048126220703,
      "model/head/act_norm_mean": 111.2252900094697,
      "model/head/act_norm_min": 62.22467803955078,
      "model/head/act_over_embed": 76.43506060207872,
      "model/head/grad_frac": 0.10504648834466934,
      "model/head/grad_norm": 0.05062353238463402,
      "model/head/grad_zero_frac": 0.00020400574430823326,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7084418402777778,
      "model/head/update_ratio": 0.00086187943816185,
      "model/head/weight_delta": 9.92898178100586,
      "model/head/weight_delta_rel": 0.17418375611305237,
      "model/head/weight_norm": 58.736209869384766,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4227631986141205,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42268185162436367,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42261919379234314,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904709256461045,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08478362113237381,
      "model/modality_embedder.encoders.pose/grad_norm": 0.040858540683984756,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5448334983031674,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013193138875067234,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1439156532287598,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10272151976823807,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96953773498535,
      "model/modality_embedder/grad_frac": 0.08478362113237381,
      "model/modality_embedder/grad_norm": 0.040858540683984756,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5448334983031674,
      "model/modality_embedder/update_ratio": 0.0013193138875067234,
      "model/modality_embedder/weight_delta": 3.1439156532287598,
      "model/modality_embedder/weight_delta_rel": 0.10272151976823807,
      "model/modality_embedder/weight_norm": 30.96953773498535,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.1011734008789,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.713438953022287,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.05777359008789,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.296097257230198,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09678158909082413,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0466405488550663,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016684550791978836,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7121810913085938,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09883351624011993,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95433235168457,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.68708038330078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.694166366041365,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.374140739440918,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.97006231717161,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09156449884176254,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.044126350432634354,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014827469130977988,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.438765525817871,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11912152916193008,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.75986671447754,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.51445007324219,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.49958664021164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.139293670654297,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.210764032192333,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09243597090244293,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.044546328485012054,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001449580187909305,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7237257957458496,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12503573298454285,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.73050308227539,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.3487777709961,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.214062750521084,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.834737777709961,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.38896806637522,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08813264220952988,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.042472485452890396,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014182883314788342,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.1984317302703857,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10930721461772919,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.946298599243164,
      "model/normalizer/grad_frac": 0.35939714312553406,
      "model/normalizer/grad_norm": 0.17319905757904053,
      "model/normalizer/grad_zero_frac": 0.00020444074471015483,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0022022733464837074,
      "model/normalizer/weight_delta": 6.731566905975342,
      "model/normalizer/weight_delta_rel": 0.08669868111610413,
      "model/normalizer/weight_norm": 78.64557647705078,
      "pose_mae_dtheta": 0.050177622586488724,
      "pose_mae_dx": 0.014172361232340336,
      "pose_mae_dy": 0.02248588763177395,
      "pose_rmse_dtheta": 0.12088365852832794,
      "pose_rmse_dx": 0.03785546496510506,
      "pose_rmse_dy": 0.04707668721675873,
      "pose_rmse_mean": 0.06860527396202087,
      "rmse_dtheta": 0.02027304098010063,
      "rmse_dx": 0.0041616689413785934,
      "rmse_dy": 0.004527796059846878,
      "rmse_mean": 0.009654168970882893,
      "rotation_flip": 0.004798080772161484,
      "sparse_tokens": 32089.0,
      "step": 9700,
      "turn_loss": 0.07919903099536896,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4507061884408103,
      "grad_norm": 0.4077564775943756,
      "learning_rate": 8.966701709531344e-07,
      "loss": 0.0966,
      "mae_dtheta": 0.012010819278657436,
      "mae_dx": 0.0015752200270071626,
      "mae_dy": 0.002901081694290042,
      "pose_mae_dtheta": 0.07167721539735794,
      "pose_mae_dx": 0.025422489270567894,
      "pose_mae_dy": 0.03412318229675293,
      "pose_rmse_dtheta": 0.14141447842121124,
      "pose_rmse_dx": 0.060365330427885056,
      "pose_rmse_dy": 0.07587988674640656,
      "pose_rmse_mean": 0.09255324304103851,
      "rmse_dtheta": 0.022643791511654854,
      "rmse_dx": 0.003717069048434496,
      "rmse_dy": 0.005489399656653404,
      "rmse_mean": 0.010616753250360489,
      "rotation_flip": 0.009087604470551014,
      "sparse_tokens": 32057.0,
      "step": 9701,
      "turn_loss": 0.12189148366451263,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.45075264820665306,
      "grad_norm": 0.5809824466705322,
      "learning_rate": 8.959147875346652e-07,
      "loss": 0.1244,
      "mae_dtheta": 0.011498983949422836,
      "mae_dx": 0.0019817042630165815,
      "mae_dy": 0.0021183271892368793,
      "pose_mae_dtheta": 0.08368629962205887,
      "pose_mae_dx": 0.017029086127877235,
      "pose_mae_dy": 0.020990801975131035,
      "pose_rmse_dtheta": 0.26109498739242554,
      "pose_rmse_dx": 0.04714406654238701,
      "pose_rmse_dy": 0.047444071620702744,
      "pose_rmse_mean": 0.1185610443353653,
      "rmse_dtheta": 0.028327057138085365,
      "rmse_dx": 0.007792745716869831,
      "rmse_dy": 0.005985346157103777,
      "rmse_mean": 0.014035049825906754,
      "rotation_flip": 0.0039047247264534235,
      "sparse_tokens": 32121.0,
      "step": 9702,
      "turn_loss": 0.0884307324886322,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.45079910797249584,
      "grad_norm": 0.44143208861351013,
      "learning_rate": 8.951596911170756e-07,
      "loss": 0.0818,
      "mae_dtheta": 0.030338574200868607,
      "mae_dx": 0.011308553628623486,
      "mae_dy": 0.004251576028764248,
      "pose_mae_dtheta": 0.24776816368103027,
      "pose_mae_dx": 0.10358448326587677,
      "pose_mae_dy": 0.03996396064758301,
      "pose_rmse_dtheta": 0.44420862197875977,
      "pose_rmse_dx": 0.21432989835739136,
      "pose_rmse_dy": 0.09849207103252411,
      "pose_rmse_mean": 0.2523435354232788,
      "rmse_dtheta": 0.04734613001346588,
      "rmse_dx": 0.023333262652158737,
      "rmse_dy": 0.009536797180771828,
      "rmse_mean": 0.026738731190562248,
      "rotation_flip": 0.017660044133663177,
      "sparse_tokens": 7722.0,
      "step": 9703,
      "turn_loss": 0.18640445172786713,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.4508455677383386,
      "grad_norm": 0.4146808683872223,
      "learning_rate": 8.944048817531736e-07,
      "loss": 0.117,
      "mae_dtheta": 0.024917636066675186,
      "mae_dx": 0.013021847233176231,
      "mae_dy": 0.00788858626037836,
      "pose_mae_dtheta": 0.19442510604858398,
      "pose_mae_dx": 0.12068238854408264,
      "pose_mae_dy": 0.08107028901576996,
      "pose_rmse_dtheta": 0.35326632857322693,
      "pose_rmse_dx": 0.25887835025787354,
      "pose_rmse_dy": 0.15511640906333923,
      "pose_rmse_mean": 0.2557537257671356,
      "rmse_dtheta": 0.03986082226037979,
      "rmse_dx": 0.02644716389477253,
      "rmse_dy": 0.014025156386196613,
      "rmse_mean": 0.026777714490890503,
      "rotation_flip": 0.008620689623057842,
      "sparse_tokens": 6642.0,
      "step": 9704,
      "turn_loss": 0.22879765927791595,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4508920275041814,
      "grad_norm": 0.43526631593704224,
      "learning_rate": 8.936503594957408e-07,
      "loss": 0.1028,
      "mae_dtheta": 0.009370828978717327,
      "mae_dx": 0.0022277487441897392,
      "mae_dy": 0.0021863405127078295,
      "pose_mae_dtheta": 0.06103970855474472,
      "pose_mae_dx": 0.020745806396007538,
      "pose_mae_dy": 0.020160356536507607,
      "pose_rmse_dtheta": 0.21016576886177063,
      "pose_rmse_dx": 0.08313881605863571,
      "pose_rmse_dy": 0.0592653751373291,
      "pose_rmse_mean": 0.11752332746982574,
      "rmse_dtheta": 0.023935167118906975,
      "rmse_dx": 0.008184653706848621,
      "rmse_dy": 0.007348440587520599,
      "rmse_mean": 0.013156088069081306,
      "rotation_flip": 0.007955077104270458,
      "sparse_tokens": 32073.0,
      "step": 9705,
      "turn_loss": 0.08791246265172958,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.45093848727002417,
      "grad_norm": 0.9234837889671326,
      "learning_rate": 8.928961243975437e-07,
      "loss": 0.2196,
      "mae_dtheta": 0.028868474066257477,
      "mae_dx": 0.00808436144143343,
      "mae_dy": 0.00303562730550766,
      "pose_mae_dtheta": 0.23184055089950562,
      "pose_mae_dx": 0.06420626491308212,
      "pose_mae_dy": 0.03984125331044197,
      "pose_rmse_dtheta": 0.4636794626712799,
      "pose_rmse_dx": 0.17490233480930328,
      "pose_rmse_dy": 0.09011472016572952,
      "pose_rmse_mean": 0.2428988516330719,
      "rmse_dtheta": 0.04863324388861656,
      "rmse_dx": 0.02032005973160267,
      "rmse_dy": 0.005471185315400362,
      "rmse_mean": 0.024808164685964584,
      "rotation_flip": 0.009776536375284195,
      "sparse_tokens": 13903.0,
      "step": 9706,
      "turn_loss": 0.19539004564285278,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 21359.0,
      "epoch": 0.45098494703586695,
      "grad_norm": 0.5002184510231018,
      "learning_rate": 8.921421765113231e-07,
      "loss": 0.134,
      "mae_dtheta": 0.03798907995223999,
      "mae_dx": 0.01101781241595745,
      "mae_dy": 0.003074093023315072,
      "pose_mae_dtheta": 0.3262160122394562,
      "pose_mae_dx": 0.08097828179597855,
      "pose_mae_dy": 0.04348557069897652,
      "pose_rmse_dtheta": 0.5847817063331604,
      "pose_rmse_dx": 0.18568961322307587,
      "pose_rmse_dy": 0.1304144412279129,
      "pose_rmse_mean": 0.30029526352882385,
      "rmse_dtheta": 0.05885348469018936,
      "rmse_dx": 0.022997988387942314,
      "rmse_dy": 0.007465233560651541,
      "rmse_mean": 0.029772236943244934,
      "rotation_flip": 0.020304568111896515,
      "sparse_tokens": 16520.0,
      "step": 9707,
      "turn_loss": 0.2538284659385681,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.4510314068017097,
      "grad_norm": 0.5319250226020813,
      "learning_rate": 8.913885158898056e-07,
      "loss": 0.1107,
      "mae_dtheta": 0.027568550780415535,
      "mae_dx": 0.015550910495221615,
      "mae_dy": 0.00691197719424963,
      "pose_mae_dtheta": 0.2119082659482956,
      "pose_mae_dx": 0.12827257812023163,
      "pose_mae_dy": 0.07404856383800507,
      "pose_rmse_dtheta": 0.36388513445854187,
      "pose_rmse_dx": 0.2562887966632843,
      "pose_rmse_dy": 0.17732015252113342,
      "pose_rmse_mean": 0.2658313512802124,
      "rmse_dtheta": 0.04237421602010727,
      "rmse_dx": 0.029063189402222633,
      "rmse_dy": 0.014299549162387848,
      "rmse_mean": 0.0285789854824543,
      "rotation_flip": 0.009411764331161976,
      "sparse_tokens": 6617.0,
      "step": 9708,
      "turn_loss": 0.3003028929233551,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.4510778665675525,
      "grad_norm": 1.460869550704956,
      "learning_rate": 8.906351425856952e-07,
      "loss": 0.264,
      "mae_dtheta": 0.03208212926983833,
      "mae_dx": 0.012251521460711956,
      "mae_dy": 0.0034311574418097734,
      "pose_mae_dtheta": 0.2455122172832489,
      "pose_mae_dx": 0.09151480346918106,
      "pose_mae_dy": 0.039532244205474854,
      "pose_rmse_dtheta": 0.45485320687294006,
      "pose_rmse_dx": 0.21878698468208313,
      "pose_rmse_dy": 0.09276481717824936,
      "pose_rmse_mean": 0.25546833872795105,
      "rmse_dtheta": 0.05143747851252556,
      "rmse_dx": 0.024402400478720665,
      "rmse_dy": 0.006778652314096689,
      "rmse_mean": 0.027539510279893875,
      "rotation_flip": 0.01565217413008213,
      "sparse_tokens": 9671.0,
      "step": 9709,
      "turn_loss": 0.20327477157115936,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.4511243263333953,
      "grad_norm": 0.46211710572242737,
      "learning_rate": 8.898820566516742e-07,
      "loss": 0.1123,
      "mae_dtheta": 0.035293273627758026,
      "mae_dx": 0.01099605392664671,
      "mae_dy": 0.005080089438706636,
      "pose_mae_dtheta": 0.2532729506492615,
      "pose_mae_dx": 0.0753742903470993,
      "pose_mae_dy": 0.05426723510026932,
      "pose_rmse_dtheta": 0.4723683297634125,
      "pose_rmse_dx": 0.1764906346797943,
      "pose_rmse_dy": 0.11397440731525421,
      "pose_rmse_mean": 0.2542777955532074,
      "rmse_dtheta": 0.05271579325199127,
      "rmse_dx": 0.022690262645483017,
      "rmse_dy": 0.009786136448383331,
      "rmse_mean": 0.028397399932146072,
      "rotation_flip": 0.008417508564889431,
      "sparse_tokens": 8935.0,
      "step": 9710,
      "turn_loss": 0.18371237814426422,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.45117078609923805,
      "grad_norm": 0.5461534857749939,
      "learning_rate": 8.891292581404076e-07,
      "loss": 0.1244,
      "mae_dtheta": 0.03795287013053894,
      "mae_dx": 0.00951095949858427,
      "mae_dy": 0.0028390150982886553,
      "pose_mae_dtheta": 0.3047676384449005,
      "pose_mae_dx": 0.06705144792795181,
      "pose_mae_dy": 0.026542436331510544,
      "pose_rmse_dtheta": 0.5125345587730408,
      "pose_rmse_dx": 0.18094497919082642,
      "pose_rmse_dy": 0.07427364587783813,
      "pose_rmse_mean": 0.2559177279472351,
      "rmse_dtheta": 0.05617634579539299,
      "rmse_dx": 0.02067764289677143,
      "rmse_dy": 0.007218264043331146,
      "rmse_mean": 0.028024084866046906,
      "rotation_flip": 0.01734820380806923,
      "sparse_tokens": 14055.0,
      "step": 9711,
      "turn_loss": 0.22757072746753693,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.45121724586508083,
      "grad_norm": 0.5053201913833618,
      "learning_rate": 8.883767471045379e-07,
      "loss": 0.0916,
      "mae_dtheta": 0.005209188908338547,
      "mae_dx": 0.0011085853911936283,
      "mae_dy": 0.00130217126570642,
      "pose_mae_dtheta": 0.03670506924390793,
      "pose_mae_dx": 0.013403116725385189,
      "pose_mae_dy": 0.015061790123581886,
      "pose_rmse_dtheta": 0.12123069912195206,
      "pose_rmse_dx": 0.0425008200109005,
      "pose_rmse_dy": 0.05334945023059845,
      "pose_rmse_mean": 0.0723603218793869,
      "rmse_dtheta": 0.015458124689757824,
      "rmse_dx": 0.003208445617929101,
      "rmse_dy": 0.003744167275726795,
      "rmse_mean": 0.007470246404409409,
      "rotation_flip": 0.0025429115630686283,
      "sparse_tokens": 32073.0,
      "step": 9712,
      "turn_loss": 0.042295001447200775,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33738.0,
      "epoch": 0.4512637056309236,
      "grad_norm": 0.57401442527771,
      "learning_rate": 8.876245235966884e-07,
      "loss": 0.1346,
      "mae_dtheta": 0.027011701837182045,
      "mae_dx": 0.01413213275372982,
      "mae_dy": 0.004644474014639854,
      "pose_mae_dtheta": 0.19850851595401764,
      "pose_mae_dx": 0.11117205768823624,
      "pose_mae_dy": 0.0506613664329052,
      "pose_rmse_dtheta": 0.36507847905158997,
      "pose_rmse_dx": 0.24423521757125854,
      "pose_rmse_dy": 0.12835057079792023,
      "pose_rmse_mean": 0.2458880990743637,
      "rmse_dtheta": 0.04480145499110222,
      "rmse_dx": 0.02776387147605419,
      "rmse_dy": 0.010384981520473957,
      "rmse_mean": 0.027650102972984314,
      "rotation_flip": 0.009365994483232498,
      "sparse_tokens": 26322.0,
      "step": 9713,
      "turn_loss": 0.2660083472728729,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4513101653967664,
      "grad_norm": 0.48994117975234985,
      "learning_rate": 8.86872587669465e-07,
      "loss": 0.1673,
      "mae_dtheta": 0.007761107292026281,
      "mae_dx": 0.0015907231718301773,
      "mae_dy": 0.0017844086978584528,
      "pose_mae_dtheta": 0.052859172224998474,
      "pose_mae_dx": 0.016143880784511566,
      "pose_mae_dy": 0.01844397746026516,
      "pose_rmse_dtheta": 0.1646488606929779,
      "pose_rmse_dx": 0.04408246651291847,
      "pose_rmse_dy": 0.057698193937540054,
      "pose_rmse_mean": 0.08880984038114548,
      "rmse_dtheta": 0.01985144056379795,
      "rmse_dx": 0.005310905631631613,
      "rmse_dy": 0.005602251272648573,
      "rmse_mean": 0.010254866443574429,
      "rotation_flip": 0.004805591888725758,
      "sparse_tokens": 32137.0,
      "step": 9714,
      "turn_loss": 0.07146903872489929,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.45135662516260916,
      "grad_norm": 0.416869193315506,
      "learning_rate": 8.861209393754478e-07,
      "loss": 0.1027,
      "mae_dtheta": 0.00853086169809103,
      "mae_dx": 0.001680851448327303,
      "mae_dy": 0.002192880492657423,
      "pose_mae_dtheta": 0.0521208718419075,
      "pose_mae_dx": 0.020042963325977325,
      "pose_mae_dy": 0.028059544041752815,
      "pose_rmse_dtheta": 0.09330678731203079,
      "pose_rmse_dx": 0.050598520785570145,
      "pose_rmse_dy": 0.06000577658414841,
      "pose_rmse_mean": 0.06797036528587341,
      "rmse_dtheta": 0.016392428427934647,
      "rmse_dx": 0.005558697506785393,
      "rmse_dy": 0.0041498225182294846,
      "rmse_mean": 0.008700316771864891,
      "rotation_flip": 0.003225806402042508,
      "sparse_tokens": 32121.0,
      "step": 9715,
      "turn_loss": 0.07783684134483337,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.45140308492845194,
      "grad_norm": 0.46180006861686707,
      "learning_rate": 8.853695787672023e-07,
      "loss": 0.0795,
      "mae_dtheta": 0.008852042257785797,
      "mae_dx": 0.0014795324532315135,
      "mae_dy": 0.00214874604716897,
      "pose_mae_dtheta": 0.05946894735097885,
      "pose_mae_dx": 0.021394014358520508,
      "pose_mae_dy": 0.02538025937974453,
      "pose_rmse_dtheta": 0.15701280534267426,
      "pose_rmse_dx": 0.05773847550153732,
      "pose_rmse_dy": 0.058306511491537094,
      "pose_rmse_mean": 0.09101926535367966,
      "rmse_dtheta": 0.020680665969848633,
      "rmse_dx": 0.004019344691187143,
      "rmse_dy": 0.004651221912354231,
      "rmse_mean": 0.009783744812011719,
      "rotation_flip": 0.004442470148205757,
      "sparse_tokens": 32089.0,
      "step": 9716,
      "turn_loss": 0.06846973299980164,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35902.0,
      "epoch": 0.4514495446942947,
      "grad_norm": 0.38291385769844055,
      "learning_rate": 8.8461850589727e-07,
      "loss": 0.1079,
      "mae_dtheta": 0.03512386977672577,
      "mae_dx": 0.013280552811920643,
      "mae_dy": 0.006608649622648954,
      "pose_mae_dtheta": 0.26922208070755005,
      "pose_mae_dx": 0.10058441013097763,
      "pose_mae_dy": 0.09116554260253906,
      "pose_rmse_dtheta": 0.4631662368774414,
      "pose_rmse_dx": 0.22529363632202148,
      "pose_rmse_dy": 0.19191959500312805,
      "pose_rmse_mean": 0.29345983266830444,
      "rmse_dtheta": 0.052711039781570435,
      "rmse_dx": 0.026717059314250946,
      "rmse_dy": 0.011430219747126102,
      "rmse_mean": 0.03028610721230507,
      "rotation_flip": 0.017501508817076683,
      "sparse_tokens": 28742.0,
      "step": 9717,
      "turn_loss": 0.2712383568286896,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.45149600446013755,
      "grad_norm": 0.375721275806427,
      "learning_rate": 8.838677208181751e-07,
      "loss": 0.069,
      "mae_dtheta": 0.03347659483551979,
      "mae_dx": 0.02512848749756813,
      "mae_dy": 0.009495598264038563,
      "pose_mae_dtheta": 0.20320849120616913,
      "pose_mae_dx": 0.1742839813232422,
      "pose_mae_dy": 0.12779177725315094,
      "pose_rmse_dtheta": 0.28502002358436584,
      "pose_rmse_dx": 0.33098241686820984,
      "pose_rmse_dy": 0.2136172205209732,
      "pose_rmse_mean": 0.2765398919582367,
      "rmse_dtheta": 0.04450078308582306,
      "rmse_dx": 0.03894440457224846,
      "rmse_dy": 0.013272921554744244,
      "rmse_mean": 0.03223937004804611,
      "rotation_flip": 0.04147465527057648,
      "sparse_tokens": 3620.0,
      "step": 9718,
      "turn_loss": 0.38658854365348816,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4515424642259803,
      "grad_norm": 0.4826970100402832,
      "learning_rate": 8.831172235824187e-07,
      "loss": 0.1485,
      "mae_dtheta": 0.01598232239484787,
      "mae_dx": 0.0036659687757492065,
      "mae_dy": 0.004865576047450304,
      "pose_mae_dtheta": 0.10628246515989304,
      "pose_mae_dx": 0.040831007063388824,
      "pose_mae_dy": 0.04399746656417847,
      "pose_rmse_dtheta": 0.21512901782989502,
      "pose_rmse_dx": 0.09401527047157288,
      "pose_rmse_dy": 0.088905468583107,
      "pose_rmse_mean": 0.13268326222896576,
      "rmse_dtheta": 0.02950710989534855,
      "rmse_dx": 0.01036120019853115,
      "rmse_dy": 0.010893951170146465,
      "rmse_mean": 0.016920754685997963,
      "rotation_flip": 0.008741258643567562,
      "sparse_tokens": 32121.0,
      "step": 9719,
      "turn_loss": 0.15805363655090332,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.4515889239918231,
      "grad_norm": 0.4519801735877991,
      "learning_rate": 8.823670142424845e-07,
      "loss": 0.1131,
      "mae_dtheta": 0.03481227532029152,
      "mae_dx": 0.008999872021377087,
      "mae_dy": 0.005331927444785833,
      "pose_mae_dtheta": 0.23777560889720917,
      "pose_mae_dx": 0.07930824905633926,
      "pose_mae_dy": 0.05188385769724846,
      "pose_rmse_dtheta": 0.44167640805244446,
      "pose_rmse_dx": 0.17519094049930573,
      "pose_rmse_dy": 0.12428906559944153,
      "pose_rmse_mean": 0.2470521628856659,
      "rmse_dtheta": 0.054569076746702194,
      "rmse_dx": 0.018741553649306297,
      "rmse_dy": 0.012022547423839569,
      "rmse_mean": 0.02844439260661602,
      "rotation_flip": 0.014211886562407017,
      "sparse_tokens": 12292.0,
      "step": 9720,
      "turn_loss": 0.26347461342811584,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4516353837576659,
      "grad_norm": 0.5426514148712158,
      "learning_rate": 8.816170928508367e-07,
      "loss": 0.104,
      "mae_dtheta": 0.009290547110140324,
      "mae_dx": 0.0009854797972366214,
      "mae_dy": 0.0012386912712827325,
      "pose_mae_dtheta": 0.060093291103839874,
      "pose_mae_dx": 0.012058370746672153,
      "pose_mae_dy": 0.017514023929834366,
      "pose_rmse_dtheta": 0.18221506476402283,
      "pose_rmse_dx": 0.033376485109329224,
      "pose_rmse_dy": 0.03992890566587448,
      "pose_rmse_mean": 0.08517348766326904,
      "rmse_dtheta": 0.022758468985557556,
      "rmse_dx": 0.003962371964007616,
      "rmse_dy": 0.002524745184928179,
      "rmse_mean": 0.009748528711497784,
      "rotation_flip": 0.002270662924274802,
      "sparse_tokens": 32041.0,
      "step": 9721,
      "turn_loss": 0.049670830368995667,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.45168184352350865,
      "grad_norm": 0.3736407458782196,
      "learning_rate": 8.808674594599142e-07,
      "loss": 0.0853,
      "mae_dtheta": 0.012455791234970093,
      "mae_dx": 0.0034470870159566402,
      "mae_dy": 0.0031214638147503138,
      "pose_mae_dtheta": 0.08562576770782471,
      "pose_mae_dx": 0.029584132134914398,
      "pose_mae_dy": 0.027996324002742767,
      "pose_rmse_dtheta": 0.2075125277042389,
      "pose_rmse_dx": 0.06797883659601212,
      "pose_rmse_dy": 0.05981854721903801,
      "pose_rmse_mean": 0.11176996678113937,
      "rmse_dtheta": 0.02611035667359829,
      "rmse_dx": 0.009588207118213177,
      "rmse_dy": 0.007418352644890547,
      "rmse_mean": 0.014372305944561958,
      "rotation_flip": 0.007087411358952522,
      "sparse_tokens": 32201.0,
      "step": 9722,
      "turn_loss": 0.13234485685825348,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.45172830328935143,
      "grad_norm": 0.458640456199646,
      "learning_rate": 8.801181141221427e-07,
      "loss": 0.0987,
      "mae_dtheta": 0.005943218246102333,
      "mae_dx": 0.0009344530408270657,
      "mae_dy": 0.0013421858893707395,
      "pose_mae_dtheta": 0.03861234337091446,
      "pose_mae_dx": 0.011777598410844803,
      "pose_mae_dy": 0.016821984201669693,
      "pose_rmse_dtheta": 0.07350961863994598,
      "pose_rmse_dx": 0.02877144329249859,
      "pose_rmse_dy": 0.039928123354911804,
      "pose_rmse_mean": 0.047403063625097275,
      "rmse_dtheta": 0.014364812523126602,
      "rmse_dx": 0.002817988395690918,
      "rmse_dy": 0.0027817755471915007,
      "rmse_mean": 0.006654858589172363,
      "rotation_flip": 0.005188067443668842,
      "sparse_tokens": 32105.0,
      "step": 9723,
      "turn_loss": 0.047862425446510315,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.4517747630551942,
      "grad_norm": 0.5125452876091003,
      "learning_rate": 8.793690568899216e-07,
      "loss": 0.1395,
      "mae_dtheta": 0.031615883111953735,
      "mae_dx": 0.007864710874855518,
      "mae_dy": 0.006276032887399197,
      "pose_mae_dtheta": 0.22069001197814941,
      "pose_mae_dx": 0.07734803110361099,
      "pose_mae_dy": 0.07466354221105576,
      "pose_rmse_dtheta": 0.4290699362754822,
      "pose_rmse_dx": 0.21088114380836487,
      "pose_rmse_dy": 0.14289727807044983,
      "pose_rmse_mean": 0.2609494626522064,
      "rmse_dtheta": 0.04809471219778061,
      "rmse_dx": 0.02023148350417614,
      "rmse_dy": 0.009770980104804039,
      "rmse_mean": 0.02603239379823208,
      "rotation_flip": 0.01773049682378769,
      "sparse_tokens": 4527.0,
      "step": 9724,
      "turn_loss": 0.24564391374588013,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.451821222821037,
      "grad_norm": 0.6132636666297913,
      "learning_rate": 8.786202878156353e-07,
      "loss": 0.1157,
      "mae_dtheta": 0.009326579980552197,
      "mae_dx": 0.001526419073343277,
      "mae_dy": 0.0017527046147733927,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6132636666297913,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 164.04928588867188,
      "model/head/act_norm_mean": 104.30508207070707,
      "model/head/act_norm_min": 59.22930145263672,
      "model/head/act_over_embed": 71.67942891855357,
      "model/head/grad_frac": 0.08885257691144943,
      "model/head/grad_norm": 0.05449005588889122,
      "model/head/grad_zero_frac": 0.0001481659128330648,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7132210779671717,
      "model/head/update_ratio": 0.0009277034550905228,
      "model/head/weight_delta": 9.930977821350098,
      "model/head/weight_delta_rel": 0.1742187738418579,
      "model/head/weight_norm": 58.73650360107422,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42274799942970276,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4226855632970151,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226095974445343,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904734763422998,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06525509059429169,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04001857712864876,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5228244114349776,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012921883026137948,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1445066928863525,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1027408316731453,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96961784362793,
      "model/modality_embedder/grad_frac": 0.06525509059429169,
      "model/modality_embedder/grad_norm": 0.04001857712864876,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5228244114349776,
      "model/modality_embedder/update_ratio": 0.0012921883026137948,
      "model/modality_embedder/weight_delta": 3.1445066928863525,
      "model/modality_embedder/weight_delta_rel": 0.1027408316731453,
      "model/modality_embedder/weight_norm": 30.96961784362793,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.04180145263672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.032860850569183,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.096548080444336,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.828397613551843,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05810900032520294,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.035636138170957565,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012747906148433685,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.713169813156128,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09886954724788666,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95450210571289,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.80082702636719,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.970618887285553,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.265789985656738,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.472833715812396,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.058952637016773224,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.036153510212898254,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001214828691445291,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.439913272857666,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11916128545999527,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76017189025879,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.82511138916016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.73639169472503,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.09078311920166,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.686289320510284,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.055910851806402206,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03428809344768524,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001115758204832673,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7250919342041016,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1250816136598587,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.730754852294922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.56556701660156,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.459455667789,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.247998237609863,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.870395014378918,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05254552513360977,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03222426027059555,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010760577861219645,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.199718952178955,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10935121029615402,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.94658851623535,
      "model/normalizer/grad_frac": 0.20276324450969696,
      "model/normalizer/grad_norm": 0.12434732913970947,
      "model/normalizer/grad_zero_frac": 0.0001855329319369048,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001581104239448905,
      "model/normalizer/weight_delta": 6.734018802642822,
      "model/normalizer/weight_delta_rel": 0.08673026412725449,
      "model/normalizer/weight_norm": 78.6458740234375,
      "pose_mae_dtheta": 0.05724543333053589,
      "pose_mae_dx": 0.01838669739663601,
      "pose_mae_dy": 0.019530804827809334,
      "pose_rmse_dtheta": 0.15076656639575958,
      "pose_rmse_dx": 0.048011574894189835,
      "pose_rmse_dy": 0.04265953600406647,
      "pose_rmse_mean": 0.0804792270064354,
      "rmse_dtheta": 0.021921901032328606,
      "rmse_dx": 0.004376586526632309,
      "rmse_dy": 0.0034345765598118305,
      "rmse_mean": 0.00991102121770382,
      "rotation_flip": 0.002343017840757966,
      "sparse_tokens": 32105.0,
      "step": 9725,
      "turn_loss": 0.07289671152830124,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.45186768258687976,
      "grad_norm": 0.5549887418746948,
      "learning_rate": 8.778718069516429e-07,
      "loss": 0.1193,
      "mae_dtheta": 0.028545042499899864,
      "mae_dx": 0.007036994211375713,
      "mae_dy": 0.005312774330377579,
      "pose_mae_dtheta": 0.1955489069223404,
      "pose_mae_dx": 0.05270605534315109,
      "pose_mae_dy": 0.04879823327064514,
      "pose_rmse_dtheta": 0.3912881910800934,
      "pose_rmse_dx": 0.142838716506958,
      "pose_rmse_dy": 0.11044740676879883,
      "pose_rmse_mean": 0.21485809981822968,
      "rmse_dtheta": 0.047155797481536865,
      "rmse_dx": 0.017055518925189972,
      "rmse_dy": 0.013851807452738285,
      "rmse_mean": 0.026021040976047516,
      "rotation_flip": 0.016339870169758797,
      "sparse_tokens": 13197.0,
      "step": 9726,
      "turn_loss": 0.22105702757835388,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.45191414235272254,
      "grad_norm": 0.6513219475746155,
      "learning_rate": 8.771236143502876e-07,
      "loss": 0.1677,
      "mae_dtheta": 0.01203808095306158,
      "mae_dx": 0.001724925241433084,
      "mae_dy": 0.0029498001094907522,
      "pose_mae_dtheta": 0.0824074074625969,
      "pose_mae_dx": 0.029190383851528168,
      "pose_mae_dy": 0.03770176321268082,
      "pose_rmse_dtheta": 0.1570141613483429,
      "pose_rmse_dx": 0.0770023763179779,
      "pose_rmse_dy": 0.09699350595474243,
      "pose_rmse_mean": 0.11033668369054794,
      "rmse_dtheta": 0.021621936932206154,
      "rmse_dx": 0.004369896370917559,
      "rmse_dy": 0.005923242773860693,
      "rmse_mean": 0.010638359002768993,
      "rotation_flip": 0.006864988710731268,
      "sparse_tokens": 32105.0,
      "step": 9727,
      "turn_loss": 0.09815820306539536,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4519606021185653,
      "grad_norm": 0.3288661539554596,
      "learning_rate": 8.76375710063892e-07,
      "loss": 0.1004,
      "mae_dtheta": 0.00949445366859436,
      "mae_dx": 0.0016941378125920892,
      "mae_dy": 0.0024268284905701876,
      "pose_mae_dtheta": 0.05991025269031525,
      "pose_mae_dx": 0.018551480025053024,
      "pose_mae_dy": 0.022758502513170242,
      "pose_rmse_dtheta": 0.14495380222797394,
      "pose_rmse_dx": 0.04215562343597412,
      "pose_rmse_dy": 0.05372663214802742,
      "pose_rmse_mean": 0.08027868717908859,
      "rmse_dtheta": 0.020699363201856613,
      "rmse_dx": 0.00469604367390275,
      "rmse_dy": 0.004990836605429649,
      "rmse_mean": 0.010128747671842575,
      "rotation_flip": 0.0039032006170600653,
      "sparse_tokens": 32105.0,
      "step": 9728,
      "turn_loss": 0.08278008550405502,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4520070618844081,
      "grad_norm": 0.5371415019035339,
      "learning_rate": 8.756280941447554e-07,
      "loss": 0.0961,
      "mae_dtheta": 0.004973785486072302,
      "mae_dx": 0.0007186574512161314,
      "mae_dy": 0.0008578152046538889,
      "pose_mae_dtheta": 0.035412222146987915,
      "pose_mae_dx": 0.008542945608496666,
      "pose_mae_dy": 0.013016258366405964,
      "pose_rmse_dtheta": 0.12925152480602264,
      "pose_rmse_dx": 0.021854190155863762,
      "pose_rmse_dy": 0.03429792821407318,
      "pose_rmse_mean": 0.06180121749639511,
      "rmse_dtheta": 0.013958709314465523,
      "rmse_dx": 0.0024326543789356947,
      "rmse_dy": 0.001962567213922739,
      "rmse_mean": 0.006117976736277342,
      "rotation_flip": 0.001124859438277781,
      "sparse_tokens": 32073.0,
      "step": 9729,
      "turn_loss": 0.038688596338033676,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33738.0,
      "epoch": 0.45205352165025087,
      "grad_norm": 0.49017325043678284,
      "learning_rate": 8.748807666451608e-07,
      "loss": 0.1613,
      "mae_dtheta": 0.024172741919755936,
      "mae_dx": 0.008675703778862953,
      "mae_dy": 0.004424260929226875,
      "pose_mae_dtheta": 0.18221452832221985,
      "pose_mae_dx": 0.06943779438734055,
      "pose_mae_dy": 0.05378388985991478,
      "pose_rmse_dtheta": 0.3060512840747833,
      "pose_rmse_dx": 0.1538015753030777,
      "pose_rmse_dy": 0.12034093588590622,
      "pose_rmse_mean": 0.19339793920516968,
      "rmse_dtheta": 0.03918342664837837,
      "rmse_dx": 0.019096123054623604,
      "rmse_dy": 0.00803365558385849,
      "rmse_mean": 0.022104403004050255,
      "rotation_flip": 0.015933716669678688,
      "sparse_tokens": 26683.0,
      "step": 9730,
      "turn_loss": 0.20658499002456665,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.45209998141609364,
      "grad_norm": 0.29247379302978516,
      "learning_rate": 8.741337276173667e-07,
      "loss": 0.0736,
      "mae_dtheta": 0.009565560147166252,
      "mae_dx": 0.0014227476203814149,
      "mae_dy": 0.0022056337911635637,
      "pose_mae_dtheta": 0.06288327276706696,
      "pose_mae_dx": 0.016402412205934525,
      "pose_mae_dy": 0.023897526785731316,
      "pose_rmse_dtheta": 0.1431872397661209,
      "pose_rmse_dx": 0.04533854126930237,
      "pose_rmse_dy": 0.0552738718688488,
      "pose_rmse_mean": 0.08126655220985413,
      "rmse_dtheta": 0.02022780105471611,
      "rmse_dx": 0.004816435277462006,
      "rmse_dy": 0.005882364232093096,
      "rmse_mean": 0.010308867320418358,
      "rotation_flip": 0.010575792752206326,
      "sparse_tokens": 32121.0,
      "step": 9731,
      "turn_loss": 0.09067078679800034,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.4521464411819364,
      "grad_norm": 0.6882469654083252,
      "learning_rate": 8.733869771136172e-07,
      "loss": 0.2297,
      "mae_dtheta": 0.03554614260792732,
      "mae_dx": 0.01218302920460701,
      "mae_dy": 0.008601597510278225,
      "pose_mae_dtheta": 0.2533348500728607,
      "pose_mae_dx": 0.08377765119075775,
      "pose_mae_dy": 0.12344130873680115,
      "pose_rmse_dtheta": 0.39497044682502747,
      "pose_rmse_dx": 0.18477356433868408,
      "pose_rmse_dy": 0.3028661608695984,
      "pose_rmse_mean": 0.29420340061187744,
      "rmse_dtheta": 0.050074148923158646,
      "rmse_dx": 0.025669287890195847,
      "rmse_dy": 0.020618092268705368,
      "rmse_mean": 0.032120510935783386,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 5101.0,
      "step": 9732,
      "turn_loss": 0.30097606778144836,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.4521929009477792,
      "grad_norm": 0.47356319427490234,
      "learning_rate": 8.7264051518613e-07,
      "loss": 0.0863,
      "mae_dtheta": 0.03575434163212776,
      "mae_dx": 0.01860983669757843,
      "mae_dy": 0.005440717563033104,
      "pose_mae_dtheta": 0.3087584674358368,
      "pose_mae_dx": 0.1410268396139145,
      "pose_mae_dy": 0.06423436850309372,
      "pose_rmse_dtheta": 0.4594230353832245,
      "pose_rmse_dx": 0.29350391030311584,
      "pose_rmse_dy": 0.15310454368591309,
      "pose_rmse_mean": 0.30201050639152527,
      "rmse_dtheta": 0.04941607639193535,
      "rmse_dx": 0.03237418830394745,
      "rmse_dy": 0.010394718497991562,
      "rmse_mean": 0.030728330835700035,
      "rotation_flip": 0.0026420080102980137,
      "sparse_tokens": 12800.0,
      "step": 9733,
      "turn_loss": 0.26091712713241577,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.45223936071362203,
      "grad_norm": 0.46172693371772766,
      "learning_rate": 8.718943418871084e-07,
      "loss": 0.0914,
      "mae_dtheta": 0.023063253611326218,
      "mae_dx": 0.007597371470183134,
      "mae_dy": 0.004348541144281626,
      "pose_mae_dtheta": 0.18051747977733612,
      "pose_mae_dx": 0.05606788024306297,
      "pose_mae_dy": 0.03574429824948311,
      "pose_rmse_dtheta": 0.2892500162124634,
      "pose_rmse_dx": 0.1242901086807251,
      "pose_rmse_dy": 0.07397612184286118,
      "pose_rmse_mean": 0.16250541806221008,
      "rmse_dtheta": 0.03582903742790222,
      "rmse_dx": 0.01560729369521141,
      "rmse_dy": 0.008828213438391685,
      "rmse_mean": 0.020088180899620056,
      "rotation_flip": 0.02074688859283924,
      "sparse_tokens": 3757.0,
      "step": 9734,
      "turn_loss": 0.2739626169204712,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 36550.0,
      "epoch": 0.4522858204794648,
      "grad_norm": 0.4126567840576172,
      "learning_rate": 8.711484572687295e-07,
      "loss": 0.1139,
      "mae_dtheta": 0.03122064657509327,
      "mae_dx": 0.014084439724683762,
      "mae_dy": 0.005487636663019657,
      "pose_mae_dtheta": 0.2510652244091034,
      "pose_mae_dx": 0.11279429495334625,
      "pose_mae_dy": 0.07484780997037888,
      "pose_rmse_dtheta": 0.4205775558948517,
      "pose_rmse_dx": 0.24190442264080048,
      "pose_rmse_dy": 0.17543232440948486,
      "pose_rmse_mean": 0.27930477261543274,
      "rmse_dtheta": 0.0465819351375103,
      "rmse_dx": 0.027338819578289986,
      "rmse_dy": 0.011726685799658298,
      "rmse_mean": 0.02854914776980877,
      "rotation_flip": 0.013221990317106247,
      "sparse_tokens": 28911.0,
      "step": 9735,
      "turn_loss": 0.25520315766334534,
      "turns": 113.0,
      "turns_per_sample": 113.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.4523322802453076,
      "grad_norm": 0.69544517993927,
      "learning_rate": 8.704028613831561e-07,
      "loss": 0.1306,
      "mae_dtheta": 0.0208731796592474,
      "mae_dx": 0.008629446849226952,
      "mae_dy": 0.005758990533649921,
      "pose_mae_dtheta": 0.1466139853000641,
      "pose_mae_dx": 0.07482311129570007,
      "pose_mae_dy": 0.07709759473800659,
      "pose_rmse_dtheta": 0.25321441888809204,
      "pose_rmse_dx": 0.20751246809959412,
      "pose_rmse_dy": 0.18802954256534576,
      "pose_rmse_mean": 0.2162521481513977,
      "rmse_dtheta": 0.03416580706834793,
      "rmse_dx": 0.022118765860795975,
      "rmse_dy": 0.012639295309782028,
      "rmse_mean": 0.02297462336719036,
      "rotation_flip": 0.01604278013110161,
      "sparse_tokens": 15065.0,
      "step": 9736,
      "turn_loss": 0.22623078525066376,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.45237874001115036,
      "grad_norm": 0.4948001205921173,
      "learning_rate": 8.696575542825265e-07,
      "loss": 0.1242,
      "mae_dtheta": 0.032313935458660126,
      "mae_dx": 0.010909447446465492,
      "mae_dy": 0.009938681498169899,
      "pose_mae_dtheta": 0.24106061458587646,
      "pose_mae_dx": 0.09912421554327011,
      "pose_mae_dy": 0.08454055339097977,
      "pose_rmse_dtheta": 0.4593368172645569,
      "pose_rmse_dx": 0.2209785133600235,
      "pose_rmse_dy": 0.21477940678596497,
      "pose_rmse_mean": 0.29836493730545044,
      "rmse_dtheta": 0.0525129996240139,
      "rmse_dx": 0.021809717640280724,
      "rmse_dy": 0.022026892751455307,
      "rmse_mean": 0.032116539776325226,
      "rotation_flip": 0.011310084722936153,
      "sparse_tokens": 17327.0,
      "step": 9737,
      "turn_loss": 0.36293596029281616,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 11021.0,
      "epoch": 0.45242519977699314,
      "grad_norm": 0.7274434566497803,
      "learning_rate": 8.689125360189621e-07,
      "loss": 0.2265,
      "mae_dtheta": 0.0273877065628767,
      "mae_dx": 0.003220311366021633,
      "mae_dy": 0.003391338512301445,
      "pose_mae_dtheta": 0.181533545255661,
      "pose_mae_dx": 0.028943199664354324,
      "pose_mae_dy": 0.04668622836470604,
      "pose_rmse_dtheta": 0.3667503297328949,
      "pose_rmse_dx": 0.10812931507825851,
      "pose_rmse_dy": 0.08786161243915558,
      "pose_rmse_mean": 0.1875804364681244,
      "rmse_dtheta": 0.044482991099357605,
      "rmse_dx": 0.01062462292611599,
      "rmse_dy": 0.0058654784224927425,
      "rmse_mean": 0.02032436430454254,
      "rotation_flip": 0.016393441706895828,
      "sparse_tokens": 9246.0,
      "step": 9738,
      "turn_loss": 0.1836870163679123,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4524716595428359,
      "grad_norm": 0.4192068576812744,
      "learning_rate": 8.681678066445598e-07,
      "loss": 0.0925,
      "mae_dtheta": 0.00805505272001028,
      "mae_dx": 0.0010473518632352352,
      "mae_dy": 0.0017593653174117208,
      "pose_mae_dtheta": 0.04734906554222107,
      "pose_mae_dx": 0.012271673418581486,
      "pose_mae_dy": 0.020296713337302208,
      "pose_rmse_dtheta": 0.103049635887146,
      "pose_rmse_dx": 0.0284450463950634,
      "pose_rmse_dy": 0.042214274406433105,
      "pose_rmse_mean": 0.0579029880464077,
      "rmse_dtheta": 0.016896255314350128,
      "rmse_dx": 0.0030625055078417063,
      "rmse_dy": 0.003996007144451141,
      "rmse_mean": 0.00798492319881916,
      "rotation_flip": 0.0028524857480078936,
      "sparse_tokens": 32089.0,
      "step": 9739,
      "turn_loss": 0.0744619145989418,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.4525181193086787,
      "grad_norm": 0.49318549036979675,
      "learning_rate": 8.674233662114017e-07,
      "loss": 0.0875,
      "mae_dtheta": 0.02876967564225197,
      "mae_dx": 0.005255764350295067,
      "mae_dy": 0.004974735900759697,
      "pose_mae_dtheta": 0.19194595515727997,
      "pose_mae_dx": 0.046307988464832306,
      "pose_mae_dy": 0.04606252908706665,
      "pose_rmse_dtheta": 0.38223767280578613,
      "pose_rmse_dx": 0.134262353181839,
      "pose_rmse_dy": 0.10293065011501312,
      "pose_rmse_mean": 0.20647689700126648,
      "rmse_dtheta": 0.047690216451883316,
      "rmse_dx": 0.014203048311173916,
      "rmse_dy": 0.010405901819467545,
      "rmse_mean": 0.024099722504615784,
      "rotation_flip": 0.009478673338890076,
      "sparse_tokens": 16913.0,
      "step": 9740,
      "turn_loss": 0.21893632411956787,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.45256457907452147,
      "grad_norm": 0.6946976184844971,
      "learning_rate": 8.666792147715447e-07,
      "loss": 0.1757,
      "mae_dtheta": 0.04260890558362007,
      "mae_dx": 0.011345205828547478,
      "mae_dy": 0.0052378131076693535,
      "pose_mae_dtheta": 0.3328996002674103,
      "pose_mae_dx": 0.07896425575017929,
      "pose_mae_dy": 0.082783043384552,
      "pose_rmse_dtheta": 0.5819763541221619,
      "pose_rmse_dx": 0.19944913685321808,
      "pose_rmse_dy": 0.18525095283985138,
      "pose_rmse_mean": 0.3222254812717438,
      "rmse_dtheta": 0.06091436743736267,
      "rmse_dx": 0.02480955980718136,
      "rmse_dy": 0.009779674001038074,
      "rmse_mean": 0.03183453530073166,
      "rotation_flip": 0.0072289155796170235,
      "sparse_tokens": 7189.0,
      "step": 9741,
      "turn_loss": 0.26476842164993286,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.45261103884036424,
      "grad_norm": 0.5320806503295898,
      "learning_rate": 8.659353523770298e-07,
      "loss": 0.1273,
      "mae_dtheta": 0.010046612471342087,
      "mae_dx": 0.0014451275346800685,
      "mae_dy": 0.002067993627861142,
      "pose_mae_dtheta": 0.0638151466846466,
      "pose_mae_dx": 0.016573144122958183,
      "pose_mae_dy": 0.026573777198791504,
      "pose_rmse_dtheta": 0.13229237496852875,
      "pose_rmse_dx": 0.037406738847494125,
      "pose_rmse_dy": 0.06327103823423386,
      "pose_rmse_mean": 0.07765671610832214,
      "rmse_dtheta": 0.01948406547307968,
      "rmse_dx": 0.0041015674360096455,
      "rmse_dy": 0.004689101129770279,
      "rmse_mean": 0.009424911811947823,
      "rotation_flip": 0.0049019609577953815,
      "sparse_tokens": 32137.0,
      "step": 9742,
      "turn_loss": 0.0720427930355072,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31046.0,
      "epoch": 0.452657498606207,
      "grad_norm": 1.0505486726760864,
      "learning_rate": 8.651917790798736e-07,
      "loss": 0.317,
      "mae_dtheta": 0.04444623365998268,
      "mae_dx": 0.011599713936448097,
      "mae_dy": 0.003424848197028041,
      "pose_mae_dtheta": 0.3859843909740448,
      "pose_mae_dx": 0.09043225646018982,
      "pose_mae_dy": 0.039698172360658646,
      "pose_rmse_dtheta": 0.6229631304740906,
      "pose_rmse_dx": 0.1957463026046753,
      "pose_rmse_dy": 0.09585020691156387,
      "pose_rmse_mean": 0.304853230714798,
      "rmse_dtheta": 0.0627785250544548,
      "rmse_dx": 0.023440903052687645,
      "rmse_dy": 0.007352566812187433,
      "rmse_mean": 0.031190667301416397,
      "rotation_flip": 0.018843404948711395,
      "sparse_tokens": 24330.0,
      "step": 9743,
      "turn_loss": 0.32311496138572693,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4527039583720498,
      "grad_norm": 0.42132052779197693,
      "learning_rate": 8.644484949320764e-07,
      "loss": 0.0871,
      "mae_dtheta": 0.014245391823351383,
      "mae_dx": 0.003174349432811141,
      "mae_dy": 0.004024976398795843,
      "pose_mae_dtheta": 0.09202586114406586,
      "pose_mae_dx": 0.03404004126787186,
      "pose_mae_dy": 0.040229663252830505,
      "pose_rmse_dtheta": 0.19105930626392365,
      "pose_rmse_dx": 0.0787687599658966,
      "pose_rmse_dy": 0.0851018950343132,
      "pose_rmse_mean": 0.11830999702215195,
      "rmse_dtheta": 0.026185201480984688,
      "rmse_dx": 0.008611059747636318,
      "rmse_dy": 0.00896295253187418,
      "rmse_mean": 0.014586403965950012,
      "rotation_flip": 0.004736343398690224,
      "sparse_tokens": 32153.0,
      "step": 9744,
      "turn_loss": 0.14237602055072784,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33636.0,
      "epoch": 0.4527504181378926,
      "grad_norm": 0.5579706430435181,
      "learning_rate": 8.637054999856148e-07,
      "loss": 0.1687,
      "mae_dtheta": 0.023207705467939377,
      "mae_dx": 0.009224515408277512,
      "mae_dy": 0.005751763004809618,
      "pose_mae_dtheta": 0.1859637051820755,
      "pose_mae_dx": 0.0787905603647232,
      "pose_mae_dy": 0.08072052896022797,
      "pose_rmse_dtheta": 0.36403974890708923,
      "pose_rmse_dx": 0.1944122612476349,
      "pose_rmse_dy": 0.20703423023223877,
      "pose_rmse_mean": 0.2551620900630951,
      "rmse_dtheta": 0.0403113029897213,
      "rmse_dx": 0.022074569016695023,
      "rmse_dy": 0.012132295407354832,
      "rmse_mean": 0.024839390069246292,
      "rotation_flip": 0.006172839552164078,
      "sparse_tokens": 24946.0,
      "step": 9745,
      "turn_loss": 0.19989340007305145,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.45279687790373535,
      "grad_norm": 0.42296302318573,
      "learning_rate": 8.629627942924473e-07,
      "loss": 0.0762,
      "mae_dtheta": 0.007914689369499683,
      "mae_dx": 0.0011404161341488361,
      "mae_dy": 0.0013551398878917098,
      "pose_mae_dtheta": 0.05344818904995918,
      "pose_mae_dx": 0.015002306550741196,
      "pose_mae_dy": 0.017181778326630592,
      "pose_rmse_dtheta": 0.1946718990802765,
      "pose_rmse_dx": 0.04121292382478714,
      "pose_rmse_dy": 0.04873846098780632,
      "pose_rmse_mean": 0.09487442672252655,
      "rmse_dtheta": 0.023040492087602615,
      "rmse_dx": 0.0034612820018082857,
      "rmse_dy": 0.003565937513485551,
      "rmse_mean": 0.010022571310400963,
      "rotation_flip": 0.000980873010121286,
      "sparse_tokens": 32073.0,
      "step": 9746,
      "turn_loss": 0.055237703025341034,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4528433376695781,
      "grad_norm": 0.44741737842559814,
      "learning_rate": 8.622203779045135e-07,
      "loss": 0.1084,
      "mae_dtheta": 0.007790341041982174,
      "mae_dx": 0.00192896812222898,
      "mae_dy": 0.0020430381409823895,
      "pose_mae_dtheta": 0.05532537400722504,
      "pose_mae_dx": 0.018807709217071533,
      "pose_mae_dy": 0.024104483425617218,
      "pose_rmse_dtheta": 0.13951456546783447,
      "pose_rmse_dx": 0.06327502429485321,
      "pose_rmse_dy": 0.058464013040065765,
      "pose_rmse_mean": 0.08708453178405762,
      "rmse_dtheta": 0.01814940758049488,
      "rmse_dx": 0.0073201474733650684,
      "rmse_dy": 0.006903363857418299,
      "rmse_mean": 0.010790972970426083,
      "rotation_flip": 0.002979991491883993,
      "sparse_tokens": 32105.0,
      "step": 9747,
      "turn_loss": 0.07653506100177765,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4528897974354209,
      "grad_norm": 0.7486621737480164,
      "learning_rate": 8.614782508737285e-07,
      "loss": 0.1179,
      "mae_dtheta": 0.007727081421762705,
      "mae_dx": 0.0034253194462507963,
      "mae_dy": 0.001346323755569756,
      "pose_mae_dtheta": 0.05492900311946869,
      "pose_mae_dx": 0.0317729227244854,
      "pose_mae_dy": 0.018728792667388916,
      "pose_rmse_dtheta": 0.14077962934970856,
      "pose_rmse_dx": 0.10995816439390182,
      "pose_rmse_dy": 0.045208919793367386,
      "pose_rmse_mean": 0.09864890575408936,
      "rmse_dtheta": 0.01829754188656807,
      "rmse_dx": 0.01211949996650219,
      "rmse_dy": 0.0029968859162181616,
      "rmse_mean": 0.011137976311147213,
      "rotation_flip": 0.005134055856615305,
      "sparse_tokens": 32057.0,
      "step": 9748,
      "turn_loss": 0.06211675703525543,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7145.0,
      "epoch": 0.4529362572012637,
      "grad_norm": 0.8381702303886414,
      "learning_rate": 8.607364132519919e-07,
      "loss": 0.1197,
      "mae_dtheta": 0.034745994955301285,
      "mae_dx": 0.008209167048335075,
      "mae_dy": 0.004550513811409473,
      "pose_mae_dtheta": 0.2638360857963562,
      "pose_mae_dx": 0.06758421659469604,
      "pose_mae_dy": 0.055781833827495575,
      "pose_rmse_dtheta": 0.5209449529647827,
      "pose_rmse_dx": 0.18506798148155212,
      "pose_rmse_dy": 0.12199296057224274,
      "pose_rmse_mean": 0.2760019898414612,
      "rmse_dtheta": 0.056141238659620285,
      "rmse_dx": 0.019407611340284348,
      "rmse_dy": 0.009695805609226227,
      "rmse_mean": 0.028414886444807053,
      "rotation_flip": 0.008522727526724339,
      "sparse_tokens": 6221.0,
      "step": 9749,
      "turn_loss": 0.21210743486881256,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.4529827169671065,
      "grad_norm": 0.8071079254150391,
      "learning_rate": 8.599948650911783e-07,
      "loss": 0.2609,
      "mae_dtheta": 0.02886248379945755,
      "mae_dx": 0.013557168655097485,
      "mae_dy": 0.005012609530240297,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8071079850196838,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 163.82754516601562,
      "model/head/act_norm_mean": 104.90038141214623,
      "model/head/act_norm_min": 66.82640075683594,
      "model/head/act_over_embed": 72.0885241992708,
      "model/head/grad_frac": 0.12284954637289047,
      "model/head/grad_norm": 0.09915284812450409,
      "model/head/grad_zero_frac": 0.0001725958427414298,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6951650943396226,
      "model/head/update_ratio": 0.001688086544163525,
      "model/head/weight_delta": 9.932509422302246,
      "model/head/weight_delta_rel": 0.17424564063549042,
      "model/head/weight_norm": 58.7368278503418,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42269012331962585,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42269012331962585,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42269012331962585,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904766100325295,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12980066239833832,
      "model/modality_embedder.encoders.pose/grad_norm": 0.10476315021514893,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.003382776165381074,
      "model/modality_embedder.encoders.pose/weight_delta": 3.144148826599121,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10272914171218872,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96957778930664,
      "model/modality_embedder/grad_frac": 0.12980066239833832,
      "model/modality_embedder/grad_norm": 0.10476315021514893,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.003382776165381074,
      "model/modality_embedder/weight_delta": 3.144148826599121,
      "model/modality_embedder/weight_delta_rel": 0.10272914171218872,
      "model/modality_embedder/weight_norm": 30.96957778930664,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.1200180053711,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.15843300763702,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.16358757019043,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.914691975513916,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09736783057451248,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.07858635485172272,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002811203943565488,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7141027450561523,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09890354424715042,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.954696655273438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.00188446044922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.937804170410303,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.640288352966309,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.450283135159502,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09800997376441956,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07910463213920593,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0026580418925732374,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.441192150115967,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11920558661222458,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.7604923248291,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 84.5826644897461,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.551011717580113,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.102051734924316,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.558894464661606,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09347689896821976,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07544595003128052,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0024550273083150387,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7264530658721924,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12512731552124023,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.731204986572266,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.419677734375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.380084325396826,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.915114402770996,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.8158502848008,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0851619765162468,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06873491406440735,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0022952172439545393,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.201047420501709,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10939660668373108,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.947017669677734,
      "model/normalizer/grad_frac": 0.33110323548316956,
      "model/normalizer/grad_norm": 0.26723605394363403,
      "model/normalizer/grad_zero_frac": 0.00019144162070006132,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0033979450818151236,
      "model/normalizer/weight_delta": 6.7365593910217285,
      "model/normalizer/weight_delta_rel": 0.08676298707723618,
      "model/normalizer/weight_norm": 78.64636993408203,
      "pose_mae_dtheta": 0.22589312493801117,
      "pose_mae_dx": 0.12429392337799072,
      "pose_mae_dy": 0.05802704021334648,
      "pose_rmse_dtheta": 0.3939143419265747,
      "pose_rmse_dx": 0.25485432147979736,
      "pose_rmse_dy": 0.13011841475963593,
      "pose_rmse_mean": 0.2596290409564972,
      "rmse_dtheta": 0.04409722238779068,
      "rmse_dx": 0.026048049330711365,
      "rmse_dy": 0.010047261603176594,
      "rmse_mean": 0.026730846613645554,
      "rotation_flip": 0.010362694039940834,
      "sparse_tokens": 14485.0,
      "step": 9750,
      "turn_loss": 0.25977823138237,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4530291767329493,
      "grad_norm": 0.4180285632610321,
      "learning_rate": 8.592536064431467e-07,
      "loss": 0.0976,
      "mae_dtheta": 0.012547612190246582,
      "mae_dx": 0.0020909321028739214,
      "mae_dy": 0.0033047436736524105,
      "pose_mae_dtheta": 0.08108032494783401,
      "pose_mae_dx": 0.02956506423652172,
      "pose_mae_dy": 0.03311736881732941,
      "pose_rmse_dtheta": 0.19651225209236145,
      "pose_rmse_dx": 0.08836883306503296,
      "pose_rmse_dy": 0.07913658022880554,
      "pose_rmse_mean": 0.12133922427892685,
      "rmse_dtheta": 0.026481185108423233,
      "rmse_dx": 0.005900859367102385,
      "rmse_dy": 0.007318152580410242,
      "rmse_mean": 0.013233399949967861,
      "rotation_flip": 0.005367464851588011,
      "sparse_tokens": 32073.0,
      "step": 9751,
      "turn_loss": 0.10525014996528625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.45307563649879207,
      "grad_norm": 0.3903697729110718,
      "learning_rate": 8.585126373597325e-07,
      "loss": 0.0845,
      "mae_dtheta": 0.009465057402849197,
      "mae_dx": 0.0015013195807114244,
      "mae_dy": 0.0025549440179020166,
      "pose_mae_dtheta": 0.05702684447169304,
      "pose_mae_dx": 0.02090955711901188,
      "pose_mae_dy": 0.02754741907119751,
      "pose_rmse_dtheta": 0.11915961652994156,
      "pose_rmse_dx": 0.05162796750664711,
      "pose_rmse_dy": 0.05557727813720703,
      "pose_rmse_mean": 0.0754549577832222,
      "rmse_dtheta": 0.018568038940429688,
      "rmse_dx": 0.004246496595442295,
      "rmse_dy": 0.005325189791619778,
      "rmse_mean": 0.009379908442497253,
      "rotation_flip": 0.0029576076194643974,
      "sparse_tokens": 32105.0,
      "step": 9752,
      "turn_loss": 0.07909251004457474,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.45312209626463484,
      "grad_norm": 0.5034267902374268,
      "learning_rate": 8.577719578927519e-07,
      "loss": 0.1153,
      "mae_dtheta": 0.006623090244829655,
      "mae_dx": 0.0010783994803205132,
      "mae_dy": 0.0012485651532188058,
      "pose_mae_dtheta": 0.04064590856432915,
      "pose_mae_dx": 0.012392318807542324,
      "pose_mae_dy": 0.014620654284954071,
      "pose_rmse_dtheta": 0.10673489421606064,
      "pose_rmse_dx": 0.032406996935606,
      "pose_rmse_dy": 0.03831784054636955,
      "pose_rmse_mean": 0.0591532438993454,
      "rmse_dtheta": 0.01763278804719448,
      "rmse_dx": 0.003452329197898507,
      "rmse_dy": 0.0027671130374073982,
      "rmse_mean": 0.007950743660330772,
      "rotation_flip": 0.003323639277368784,
      "sparse_tokens": 32153.0,
      "step": 9753,
      "turn_loss": 0.045500051230192184,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4531685560304776,
      "grad_norm": 0.3440023958683014,
      "learning_rate": 8.570315680940028e-07,
      "loss": 0.0747,
      "mae_dtheta": 0.004316794686019421,
      "mae_dx": 0.0008714221767149866,
      "mae_dy": 0.0004979311488568783,
      "pose_mae_dtheta": 0.028583122417330742,
      "pose_mae_dx": 0.007804666645824909,
      "pose_mae_dy": 0.00858295988291502,
      "pose_rmse_dtheta": 0.11349990218877792,
      "pose_rmse_dx": 0.021183419972658157,
      "pose_rmse_dy": 0.02560899406671524,
      "pose_rmse_mean": 0.05343077704310417,
      "rmse_dtheta": 0.016252433881163597,
      "rmse_dx": 0.0029699753504246473,
      "rmse_dy": 0.0011518743121996522,
      "rmse_mean": 0.006791427731513977,
      "rotation_flip": 0.0011947430903092027,
      "sparse_tokens": 32121.0,
      "step": 9754,
      "turn_loss": 0.04224050045013428,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4532150157963204,
      "grad_norm": 0.41074278950691223,
      "learning_rate": 8.562914680152584e-07,
      "loss": 0.1259,
      "mae_dtheta": 0.009050904773175716,
      "mae_dx": 0.0017688412917777896,
      "mae_dy": 0.003092939732596278,
      "pose_mae_dtheta": 0.05804860591888428,
      "pose_mae_dx": 0.023032689467072487,
      "pose_mae_dy": 0.0281306691467762,
      "pose_rmse_dtheta": 0.14228129386901855,
      "pose_rmse_dx": 0.075348861515522,
      "pose_rmse_dy": 0.07637950032949448,
      "pose_rmse_mean": 0.09800322353839874,
      "rmse_dtheta": 0.02151396870613098,
      "rmse_dx": 0.005080965347588062,
      "rmse_dy": 0.008645621128380299,
      "rmse_mean": 0.011746851727366447,
      "rotation_flip": 0.006808169651776552,
      "sparse_tokens": 32105.0,
      "step": 9755,
      "turn_loss": 0.07180590182542801,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34388.0,
      "epoch": 0.4532614755621632,
      "grad_norm": 0.42614662647247314,
      "learning_rate": 8.555516577082773e-07,
      "loss": 0.0869,
      "mae_dtheta": 0.023882964625954628,
      "mae_dx": 0.00983396079391241,
      "mae_dy": 0.0026560225524008274,
      "pose_mae_dtheta": 0.18454988300800323,
      "pose_mae_dx": 0.06810961663722992,
      "pose_mae_dy": 0.026786530390381813,
      "pose_rmse_dtheta": 0.3646756410598755,
      "pose_rmse_dx": 0.16902253031730652,
      "pose_rmse_dy": 0.07809661328792572,
      "pose_rmse_mean": 0.20393161475658417,
      "rmse_dtheta": 0.041936181485652924,
      "rmse_dx": 0.021531416103243828,
      "rmse_dy": 0.006981263868510723,
      "rmse_mean": 0.023482954129576683,
      "rotation_flip": 0.007961783558130264,
      "sparse_tokens": 25899.0,
      "step": 9756,
      "turn_loss": 0.1846926212310791,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.45330793532800595,
      "grad_norm": 0.4674758017063141,
      "learning_rate": 8.54812137224792e-07,
      "loss": 0.0657,
      "mae_dtheta": 0.024981774389743805,
      "mae_dx": 0.009490740485489368,
      "mae_dy": 0.007173433434218168,
      "pose_mae_dtheta": 0.21931293606758118,
      "pose_mae_dx": 0.08357511460781097,
      "pose_mae_dy": 0.08844621479511261,
      "pose_rmse_dtheta": 0.33369240164756775,
      "pose_rmse_dx": 0.18253690004348755,
      "pose_rmse_dy": 0.16673681139945984,
      "pose_rmse_mean": 0.22765538096427917,
      "rmse_dtheta": 0.0381879098713398,
      "rmse_dx": 0.0215502567589283,
      "rmse_dy": 0.0120838712900877,
      "rmse_mean": 0.0239406805485487,
      "rotation_flip": 0.010135134682059288,
      "sparse_tokens": 5602.0,
      "step": 9757,
      "turn_loss": 0.25917285680770874,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.4533543950938487,
      "grad_norm": 0.6593772768974304,
      "learning_rate": 8.540729066165182e-07,
      "loss": 0.1855,
      "mae_dtheta": 0.03269068896770477,
      "mae_dx": 0.00968901626765728,
      "mae_dy": 0.005542703904211521,
      "pose_mae_dtheta": 0.24522466957569122,
      "pose_mae_dx": 0.08851958811283112,
      "pose_mae_dy": 0.06389177590608597,
      "pose_rmse_dtheta": 0.39330288767814636,
      "pose_rmse_dx": 0.18566125631332397,
      "pose_rmse_dy": 0.1359390914440155,
      "pose_rmse_mean": 0.238301083445549,
      "rmse_dtheta": 0.050329506397247314,
      "rmse_dx": 0.02057747356593609,
      "rmse_dy": 0.010574623942375183,
      "rmse_mean": 0.027160536497831345,
      "rotation_flip": 0.019206145778298378,
      "sparse_tokens": 12732.0,
      "step": 9758,
      "turn_loss": 0.30325230956077576,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4534008548596915,
      "grad_norm": 0.42481714487075806,
      "learning_rate": 8.533339659351531e-07,
      "loss": 0.101,
      "mae_dtheta": 0.012739993631839752,
      "mae_dx": 0.00243648630566895,
      "mae_dy": 0.003941608592867851,
      "pose_mae_dtheta": 0.0945429652929306,
      "pose_mae_dx": 0.031782425940036774,
      "pose_mae_dy": 0.03583785891532898,
      "pose_rmse_dtheta": 0.22112956643104553,
      "pose_rmse_dx": 0.08303073048591614,
      "pose_rmse_dy": 0.08628501743078232,
      "pose_rmse_mean": 0.13014844059944153,
      "rmse_dtheta": 0.027643470093607903,
      "rmse_dx": 0.006564011797308922,
      "rmse_dy": 0.008703715167939663,
      "rmse_mean": 0.01430373266339302,
      "rotation_flip": 0.004749726038426161,
      "sparse_tokens": 32121.0,
      "step": 9759,
      "turn_loss": 0.11187434196472168,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.4534473146255343,
      "grad_norm": 1.1494996547698975,
      "learning_rate": 8.525953152323685e-07,
      "loss": 0.2226,
      "mae_dtheta": 0.02722504734992981,
      "mae_dx": 0.008669114671647549,
      "mae_dy": 0.0030889275949448347,
      "pose_mae_dtheta": 0.1771434247493744,
      "pose_mae_dx": 0.06420185416936874,
      "pose_mae_dy": 0.044797882437705994,
      "pose_rmse_dtheta": 0.3306869566440582,
      "pose_rmse_dx": 0.17133164405822754,
      "pose_rmse_dy": 0.10944601148366928,
      "pose_rmse_mean": 0.20382152497768402,
      "rmse_dtheta": 0.04597984999418259,
      "rmse_dx": 0.02064216509461403,
      "rmse_dy": 0.006543456111103296,
      "rmse_mean": 0.024388492107391357,
      "rotation_flip": 0.008474576286971569,
      "sparse_tokens": 18389.0,
      "step": 9760,
      "turn_loss": 0.18980281054973602,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.45349377439137706,
      "grad_norm": 0.46177923679351807,
      "learning_rate": 8.518569545598198e-07,
      "loss": 0.0999,
      "mae_dtheta": 0.011465533636510372,
      "mae_dx": 0.0015268584247678518,
      "mae_dy": 0.002557842992246151,
      "pose_mae_dtheta": 0.07389380037784576,
      "pose_mae_dx": 0.021667594090104103,
      "pose_mae_dy": 0.03083110973238945,
      "pose_rmse_dtheta": 0.19167080521583557,
      "pose_rmse_dx": 0.05081868916749954,
      "pose_rmse_dy": 0.07197240740060806,
      "pose_rmse_mean": 0.1048206314444542,
      "rmse_dtheta": 0.023922951892018318,
      "rmse_dx": 0.004368338268250227,
      "rmse_dy": 0.005151526071131229,
      "rmse_mean": 0.011147606186568737,
      "rotation_flip": 0.0033444815780967474,
      "sparse_tokens": 32057.0,
      "step": 9761,
      "turn_loss": 0.08056667447090149,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.45354023415721983,
      "grad_norm": 0.4636071026325226,
      "learning_rate": 8.511188839691404e-07,
      "loss": 0.1216,
      "mae_dtheta": 0.024461977183818817,
      "mae_dx": 0.005544227547943592,
      "mae_dy": 0.004915783181786537,
      "pose_mae_dtheta": 0.2050757110118866,
      "pose_mae_dx": 0.04107458144426346,
      "pose_mae_dy": 0.0756128802895546,
      "pose_rmse_dtheta": 0.399799644947052,
      "pose_rmse_dx": 0.08796603977680206,
      "pose_rmse_dy": 0.1465160846710205,
      "pose_rmse_mean": 0.2114272564649582,
      "rmse_dtheta": 0.04201614111661911,
      "rmse_dx": 0.0140666663646698,
      "rmse_dy": 0.008472498506307602,
      "rmse_mean": 0.021518435329198837,
      "rotation_flip": 0.0064239827916026115,
      "sparse_tokens": 10294.0,
      "step": 9762,
      "turn_loss": 0.1809447705745697,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.4535866939230626,
      "grad_norm": 0.5021085739135742,
      "learning_rate": 8.503811035119452e-07,
      "loss": 0.0766,
      "mae_dtheta": 0.03641766682267189,
      "mae_dx": 0.008227722719311714,
      "mae_dy": 0.007439866196364164,
      "pose_mae_dtheta": 0.2766894996166229,
      "pose_mae_dx": 0.0678509920835495,
      "pose_mae_dy": 0.0776176005601883,
      "pose_rmse_dtheta": 0.5261522531509399,
      "pose_rmse_dx": 0.14328746497631073,
      "pose_rmse_dy": 0.18652185797691345,
      "pose_rmse_mean": 0.285320520401001,
      "rmse_dtheta": 0.05650706589221954,
      "rmse_dx": 0.01743331365287304,
      "rmse_dy": 0.015794461593031883,
      "rmse_mean": 0.029911614954471588,
      "rotation_flip": 0.014098690822720528,
      "sparse_tokens": 15728.0,
      "step": 9763,
      "turn_loss": 0.28216642141342163,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 30400.0,
      "epoch": 0.4536331536889054,
      "grad_norm": 0.4654594957828522,
      "learning_rate": 8.496436132398256e-07,
      "loss": 0.1207,
      "mae_dtheta": 0.03557973355054855,
      "mae_dx": 0.010852505452930927,
      "mae_dy": 0.003605683334171772,
      "pose_mae_dtheta": 0.2875727117061615,
      "pose_mae_dx": 0.08970694243907928,
      "pose_mae_dy": 0.04317879304289818,
      "pose_rmse_dtheta": 0.5237584710121155,
      "pose_rmse_dx": 0.21240761876106262,
      "pose_rmse_dy": 0.09389621019363403,
      "pose_rmse_mean": 0.2766874432563782,
      "rmse_dtheta": 0.05553188920021057,
      "rmse_dx": 0.023306196555495262,
      "rmse_dy": 0.007296994794160128,
      "rmse_mean": 0.028711695224046707,
      "rotation_flip": 0.008836524561047554,
      "sparse_tokens": 22460.0,
      "step": 9764,
      "turn_loss": 0.24916504323482513,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.45367961345474817,
      "grad_norm": 0.6433892846107483,
      "learning_rate": 8.489064132043551e-07,
      "loss": 0.1701,
      "mae_dtheta": 0.03198676556348801,
      "mae_dx": 0.015284142456948757,
      "mae_dy": 0.005788915790617466,
      "pose_mae_dtheta": 0.2510020136833191,
      "pose_mae_dx": 0.11687368899583817,
      "pose_mae_dy": 0.07788971811532974,
      "pose_rmse_dtheta": 0.4148799777030945,
      "pose_rmse_dx": 0.2639925479888916,
      "pose_rmse_dy": 0.16523443162441254,
      "pose_rmse_mean": 0.28136900067329407,
      "rmse_dtheta": 0.04769246280193329,
      "rmse_dx": 0.02934042364358902,
      "rmse_dy": 0.010969541035592556,
      "rmse_mean": 0.029334142804145813,
      "rotation_flip": 0.014666666276752949,
      "sparse_tokens": 13144.0,
      "step": 9765,
      "turn_loss": 0.3115539848804474,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.45372607322059094,
      "grad_norm": 0.35929790139198303,
      "learning_rate": 8.481695034570892e-07,
      "loss": 0.0736,
      "mae_dtheta": 0.009627081453800201,
      "mae_dx": 0.001442061853595078,
      "mae_dy": 0.0015972350956872106,
      "pose_mae_dtheta": 0.06284232437610626,
      "pose_mae_dx": 0.015825191512703896,
      "pose_mae_dy": 0.019247520714998245,
      "pose_rmse_dtheta": 0.19441139698028564,
      "pose_rmse_dx": 0.03814044967293739,
      "pose_rmse_dy": 0.04101976379752159,
      "pose_rmse_mean": 0.09119053930044174,
      "rmse_dtheta": 0.023046525195240974,
      "rmse_dx": 0.004348124377429485,
      "rmse_dy": 0.003371010534465313,
      "rmse_mean": 0.010255220346152782,
      "rotation_flip": 0.004909983836114407,
      "sparse_tokens": 32089.0,
      "step": 9766,
      "turn_loss": 0.07589662075042725,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4537725329864338,
      "grad_norm": 0.40586531162261963,
      "learning_rate": 8.474328840495566e-07,
      "loss": 0.1332,
      "mae_dtheta": 0.01080786157399416,
      "mae_dx": 0.0014224790502339602,
      "mae_dy": 0.002425297861918807,
      "pose_mae_dtheta": 0.06774310022592545,
      "pose_mae_dx": 0.02223227545619011,
      "pose_mae_dy": 0.033761631697416306,
      "pose_rmse_dtheta": 0.13468725979328156,
      "pose_rmse_dx": 0.05930135399103165,
      "pose_rmse_dy": 0.08588776737451553,
      "pose_rmse_mean": 0.09329213201999664,
      "rmse_dtheta": 0.0202930998057127,
      "rmse_dx": 0.003912367392331362,
      "rmse_dy": 0.005190718453377485,
      "rmse_mean": 0.009798728860914707,
      "rotation_flip": 0.007610853761434555,
      "sparse_tokens": 32105.0,
      "step": 9767,
      "turn_loss": 0.09821899235248566,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.45381899275227655,
      "grad_norm": 0.5031805634498596,
      "learning_rate": 8.466965550332729e-07,
      "loss": 0.1206,
      "mae_dtheta": 0.008677509613335133,
      "mae_dx": 0.0013889059191569686,
      "mae_dy": 0.002348026493564248,
      "pose_mae_dtheta": 0.05690145865082741,
      "pose_mae_dx": 0.021586637943983078,
      "pose_mae_dy": 0.026123305782675743,
      "pose_rmse_dtheta": 0.12247931957244873,
      "pose_rmse_dx": 0.06325110793113708,
      "pose_rmse_dy": 0.06374193727970123,
      "pose_rmse_mean": 0.08315745741128922,
      "rmse_dtheta": 0.018725980073213577,
      "rmse_dx": 0.004188660066574812,
      "rmse_dy": 0.005172033794224262,
      "rmse_mean": 0.009362224489450455,
      "rotation_flip": 0.006155303213745356,
      "sparse_tokens": 32057.0,
      "step": 9768,
      "turn_loss": 0.0702456384897232,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.45386545251811933,
      "grad_norm": 0.35629311203956604,
      "learning_rate": 8.459605164597268e-07,
      "loss": 0.0743,
      "mae_dtheta": 0.009424631483852863,
      "mae_dx": 0.0018222795333713293,
      "mae_dy": 0.0017349784029647708,
      "pose_mae_dtheta": 0.06513285636901855,
      "pose_mae_dx": 0.017899934202432632,
      "pose_mae_dy": 0.019630176946520805,
      "pose_rmse_dtheta": 0.20484039187431335,
      "pose_rmse_dx": 0.054564088582992554,
      "pose_rmse_dy": 0.05189024284482002,
      "pose_rmse_mean": 0.10376491397619247,
      "rmse_dtheta": 0.024419834837317467,
      "rmse_dx": 0.006159130949527025,
      "rmse_dy": 0.004665066953748465,
      "rmse_mean": 0.011748011223971844,
      "rotation_flip": 0.006837606895714998,
      "sparse_tokens": 32137.0,
      "step": 9769,
      "turn_loss": 0.06885070353746414,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.4539119122839621,
      "grad_norm": 0.9582808017730713,
      "learning_rate": 8.452247683803927e-07,
      "loss": 0.2335,
      "mae_dtheta": 0.033925339579582214,
      "mae_dx": 0.009777003899216652,
      "mae_dy": 0.005188713315874338,
      "pose_mae_dtheta": 0.25090229511260986,
      "pose_mae_dx": 0.08074052631855011,
      "pose_mae_dy": 0.07550887018442154,
      "pose_rmse_dtheta": 0.47228577733039856,
      "pose_rmse_dx": 0.19421789050102234,
      "pose_rmse_dy": 0.16709062457084656,
      "pose_rmse_mean": 0.2778647840023041,
      "rmse_dtheta": 0.05332865193486214,
      "rmse_dx": 0.022034399211406708,
      "rmse_dy": 0.010774475522339344,
      "rmse_mean": 0.02871251106262207,
      "rotation_flip": 0.015209125354886055,
      "sparse_tokens": 19360.0,
      "step": 9770,
      "turn_loss": 0.25533145666122437,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4539583720498049,
      "grad_norm": 0.4426276385784149,
      "learning_rate": 8.444893108467194e-07,
      "loss": 0.086,
      "mae_dtheta": 0.009796276688575745,
      "mae_dx": 0.0012430354254320264,
      "mae_dy": 0.0012360041728243232,
      "pose_mae_dtheta": 0.06942871958017349,
      "pose_mae_dx": 0.014166535809636116,
      "pose_mae_dy": 0.0209214985370636,
      "pose_rmse_dtheta": 0.22452108561992645,
      "pose_rmse_dx": 0.03795784339308739,
      "pose_rmse_dy": 0.0485089085996151,
      "pose_rmse_mean": 0.10366261005401611,
      "rmse_dtheta": 0.02530694007873535,
      "rmse_dx": 0.004503184463828802,
      "rmse_dy": 0.0024065147154033184,
      "rmse_mean": 0.010738879442214966,
      "rotation_flip": 0.0012711863964796066,
      "sparse_tokens": 32089.0,
      "step": 9771,
      "turn_loss": 0.06261464953422546,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.45400483181564766,
      "grad_norm": 0.5089010000228882,
      "learning_rate": 8.437541439101398e-07,
      "loss": 0.1209,
      "mae_dtheta": 0.010803417302668095,
      "mae_dx": 0.0027920028660446405,
      "mae_dy": 0.004306142218410969,
      "pose_mae_dtheta": 0.07785149663686752,
      "pose_mae_dx": 0.02947136014699936,
      "pose_mae_dy": 0.032833945006132126,
      "pose_rmse_dtheta": 0.19158324599266052,
      "pose_rmse_dx": 0.08969134092330933,
      "pose_rmse_dy": 0.07875872403383255,
      "pose_rmse_mean": 0.120011106133461,
      "rmse_dtheta": 0.023083673790097237,
      "rmse_dx": 0.008677603676915169,
      "rmse_dy": 0.012049427255988121,
      "rmse_mean": 0.014603568241000175,
      "rotation_flip": 0.0052966102957725525,
      "sparse_tokens": 32089.0,
      "step": 9772,
      "turn_loss": 0.10733441263437271,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.45405129158149043,
      "grad_norm": 0.3196268379688263,
      "learning_rate": 8.430192676220627e-07,
      "loss": 0.0593,
      "mae_dtheta": 0.007100222632288933,
      "mae_dx": 0.0013614079216495156,
      "mae_dy": 0.000242982801864855,
      "pose_mae_dtheta": 0.05103509500622749,
      "pose_mae_dx": 0.009959500283002853,
      "pose_mae_dy": 0.002831476042047143,
      "pose_rmse_dtheta": 0.22929102182388306,
      "pose_rmse_dx": 0.027297845110297203,
      "pose_rmse_dy": 0.0071196528151631355,
      "pose_rmse_mean": 0.08790284395217896,
      "rmse_dtheta": 0.02732858993113041,
      "rmse_dx": 0.004249977879226208,
      "rmse_dy": 0.0007608101586811244,
      "rmse_mean": 0.010779792442917824,
      "rotation_flip": 0.004361370578408241,
      "sparse_tokens": 32201.0,
      "step": 9773,
      "turn_loss": 0.04482785239815712,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.4540977513473332,
      "grad_norm": 0.3677229881286621,
      "learning_rate": 8.422846820338809e-07,
      "loss": 0.1014,
      "mae_dtheta": 0.02077016793191433,
      "mae_dx": 0.00729801831766963,
      "mae_dy": 0.0023996601812541485,
      "pose_mae_dtheta": 0.1571638137102127,
      "pose_mae_dx": 0.051809653639793396,
      "pose_mae_dy": 0.011344922706484795,
      "pose_rmse_dtheta": 0.341803640127182,
      "pose_rmse_dx": 0.10596621781587601,
      "pose_rmse_dy": 0.02057633362710476,
      "pose_rmse_mean": 0.15611539781093597,
      "rmse_dtheta": 0.03895627707242966,
      "rmse_dx": 0.015266372822225094,
      "rmse_dy": 0.006075960583984852,
      "rmse_mean": 0.020099537447094917,
      "rotation_flip": 0.0,
      "sparse_tokens": 6467.0,
      "step": 9774,
      "turn_loss": 0.16197289526462555,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.454144211113176,
      "grad_norm": 0.4210488796234131,
      "learning_rate": 8.415503871969616e-07,
      "loss": 0.0813,
      "mae_dtheta": 0.008013171143829823,
      "mae_dx": 0.0020515331998467445,
      "mae_dy": 0.0019019043538719416,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.421049028635025,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.69216918945312,
      "model/head/act_norm_mean": 108.00816761363636,
      "model/head/act_norm_min": 49.22768783569336,
      "model/head/act_over_embed": 74.22422397248764,
      "model/head/grad_frac": 0.10029212385416031,
      "model/head/grad_norm": 0.04222790151834488,
      "model/head/grad_zero_frac": 0.00013484050577972084,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7070855034722222,
      "model/head/update_ratio": 0.0007189303869381547,
      "model/head/weight_delta": 9.934062957763672,
      "model/head/weight_delta_rel": 0.17427289485931396,
      "model/head/weight_norm": 58.73712158203125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42275470495224,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4226845487236456,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.422608882188797,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29047277911798164,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09171220660209656,
      "model/modality_embedder.encoders.pose/grad_norm": 0.038615334779024124,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5340389601528385,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012468823697417974,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1445398330688477,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10274191945791245,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96950912475586,
      "model/modality_embedder/grad_frac": 0.09171220660209656,
      "model/modality_embedder/grad_norm": 0.038615334779024124,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5340389601528385,
      "model/modality_embedder/update_ratio": 0.0012468823697417974,
      "model/modality_embedder/weight_delta": 3.1445398330688477,
      "model/modality_embedder/weight_delta_rel": 0.10274191945791245,
      "model/modality_embedder/weight_norm": 30.96950912475586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.70301055908203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.425444925444925,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.022889137268066,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.098185065236468,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06102642044425011,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.025695115327835083,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009191656135953963,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7148849964141846,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09893205016851425,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95482635498047,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.33946990966797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.421363936988936,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.361189842224121,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.7825899339102,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06400751322507858,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.026950299739837646,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.000905561086256057,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4423322677612305,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11924508213996887,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76088523864746,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.23695373535156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.17734638047138,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.280660629272461,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.989317508837985,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07107670605182648,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.029926776885986328,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009738103253766894,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7277672290802,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12517143785953522,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.73162841796875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.84644317626953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.90221160012827,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.28749942779541,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.17466103622881,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0667496919631958,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02810489386320114,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009384769946336746,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.202354907989502,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10944129526615143,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.947343826293945,
      "model/normalizer/grad_frac": 0.20750756561756134,
      "model/normalizer/grad_norm": 0.0873708575963974,
      "model/normalizer/grad_zero_frac": 0.000219803347135894,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0011109273182228208,
      "model/normalizer/weight_delta": 6.738921165466309,
      "model/normalizer/weight_delta_rel": 0.08679340034723282,
      "model/normalizer/weight_norm": 78.64678192138672,
      "pose_mae_dtheta": 0.05808429792523384,
      "pose_mae_dx": 0.018291668966412544,
      "pose_mae_dy": 0.02041441760957241,
      "pose_rmse_dtheta": 0.15821027755737305,
      "pose_rmse_dx": 0.06402178853750229,
      "pose_rmse_dy": 0.05494796484708786,
      "pose_rmse_mean": 0.09239335358142853,
      "rmse_dtheta": 0.019191307947039604,
      "rmse_dx": 0.006978376302868128,
      "rmse_dy": 0.006154979579150677,
      "rmse_mean": 0.010774888098239899,
      "rotation_flip": 0.003604325233027339,
      "sparse_tokens": 32153.0,
      "step": 9775,
      "turn_loss": 0.06769357621669769,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.45419067087901877,
      "grad_norm": 0.6280539035797119,
      "learning_rate": 8.40816383162657e-07,
      "loss": 0.1653,
      "mae_dtheta": 0.013302699662744999,
      "mae_dx": 0.002096332609653473,
      "mae_dy": 0.0030522977467626333,
      "pose_mae_dtheta": 0.09525663405656815,
      "pose_mae_dx": 0.022036610171198845,
      "pose_mae_dy": 0.029042823240160942,
      "pose_rmse_dtheta": 0.24106860160827637,
      "pose_rmse_dx": 0.05610426515340805,
      "pose_rmse_dy": 0.06697922945022583,
      "pose_rmse_mean": 0.12138403952121735,
      "rmse_dtheta": 0.028185000643134117,
      "rmse_dx": 0.0061995103023946285,
      "rmse_dy": 0.007720413617789745,
      "rmse_mean": 0.014034975320100784,
      "rotation_flip": 0.005483744665980339,
      "sparse_tokens": 32105.0,
      "step": 9776,
      "turn_loss": 0.10110479593276978,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.45423713064486154,
      "grad_norm": 0.614037036895752,
      "learning_rate": 8.400826699822933e-07,
      "loss": 0.148,
      "mae_dtheta": 0.01024047750979662,
      "mae_dx": 0.0019245792645961046,
      "mae_dy": 0.003633120795711875,
      "pose_mae_dtheta": 0.07132057845592499,
      "pose_mae_dx": 0.030178295448422432,
      "pose_mae_dy": 0.03349016234278679,
      "pose_rmse_dtheta": 0.16973641514778137,
      "pose_rmse_dx": 0.09167145192623138,
      "pose_rmse_dy": 0.07458122819662094,
      "pose_rmse_mean": 0.1119963675737381,
      "rmse_dtheta": 0.021017586812376976,
      "rmse_dx": 0.0057340217754244804,
      "rmse_dy": 0.008074834942817688,
      "rmse_mean": 0.01160881482064724,
      "rotation_flip": 0.0015396458329632878,
      "sparse_tokens": 32057.0,
      "step": 9777,
      "turn_loss": 0.10528495162725449,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4542835904107043,
      "grad_norm": 0.4594687223434448,
      "learning_rate": 8.393492477071829e-07,
      "loss": 0.0876,
      "mae_dtheta": 0.005748910829424858,
      "mae_dx": 0.0011267040390521288,
      "mae_dy": 0.001169398776255548,
      "pose_mae_dtheta": 0.04111383482813835,
      "pose_mae_dx": 0.011291288770735264,
      "pose_mae_dy": 0.017239123582839966,
      "pose_rmse_dtheta": 0.09883920103311539,
      "pose_rmse_dx": 0.03098415397107601,
      "pose_rmse_dy": 0.050250738859176636,
      "pose_rmse_mean": 0.060024701058864594,
      "rmse_dtheta": 0.014030431397259235,
      "rmse_dx": 0.003810806665569544,
      "rmse_dy": 0.0027300729416310787,
      "rmse_mean": 0.006857104133814573,
      "rotation_flip": 0.0013204225106164813,
      "sparse_tokens": 32153.0,
      "step": 9778,
      "turn_loss": 0.04501941800117493,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.4543300501765471,
      "grad_norm": 0.5964089035987854,
      "learning_rate": 8.38616116388612e-07,
      "loss": 0.1429,
      "mae_dtheta": 0.02930454909801483,
      "mae_dx": 0.012054122053086758,
      "mae_dy": 0.007275622803717852,
      "pose_mae_dtheta": 0.21103514730930328,
      "pose_mae_dx": 0.10712108761072159,
      "pose_mae_dy": 0.10857979208230972,
      "pose_rmse_dtheta": 0.3311865031719208,
      "pose_rmse_dx": 0.22578838467597961,
      "pose_rmse_dy": 0.21626093983650208,
      "pose_rmse_mean": 0.25774526596069336,
      "rmse_dtheta": 0.042533017694950104,
      "rmse_dx": 0.025468450039625168,
      "rmse_dy": 0.012185711413621902,
      "rmse_mean": 0.026729058474302292,
      "rotation_flip": 0.01955307275056839,
      "sparse_tokens": 14974.0,
      "step": 9779,
      "turn_loss": 0.2919655442237854,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4543765099423899,
      "grad_norm": 0.32932326197624207,
      "learning_rate": 8.378832760778499e-07,
      "loss": 0.0861,
      "mae_dtheta": 0.009000014513731003,
      "mae_dx": 0.001171389245428145,
      "mae_dy": 0.002369593596085906,
      "pose_mae_dtheta": 0.05416940525174141,
      "pose_mae_dx": 0.021127302199602127,
      "pose_mae_dy": 0.027819251641631126,
      "pose_rmse_dtheta": 0.12160126119852066,
      "pose_rmse_dx": 0.05518720671534538,
      "pose_rmse_dy": 0.06261035799980164,
      "pose_rmse_mean": 0.0797996073961258,
      "rmse_dtheta": 0.018645603209733963,
      "rmse_dx": 0.0032394470181316137,
      "rmse_dy": 0.005229978356510401,
      "rmse_mean": 0.009038343094289303,
      "rotation_flip": 0.003201707499101758,
      "sparse_tokens": 32089.0,
      "step": 9780,
      "turn_loss": 0.07250349968671799,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.45442296970823265,
      "grad_norm": 0.45307955145835876,
      "learning_rate": 8.371507268261436e-07,
      "loss": 0.0857,
      "mae_dtheta": 0.042824264615774155,
      "mae_dx": 0.010627125389873981,
      "mae_dy": 0.003815812524408102,
      "pose_mae_dtheta": 0.3627040386199951,
      "pose_mae_dx": 0.07719854265451431,
      "pose_mae_dy": 0.05847306177020073,
      "pose_rmse_dtheta": 0.6230598092079163,
      "pose_rmse_dx": 0.18574832379817963,
      "pose_rmse_dy": 0.14283403754234314,
      "pose_rmse_mean": 0.31721407175064087,
      "rmse_dtheta": 0.062485676258802414,
      "rmse_dx": 0.02343713864684105,
      "rmse_dy": 0.007947004400193691,
      "rmse_mean": 0.03128994256258011,
      "rotation_flip": 0.015330188907682896,
      "sparse_tokens": 15495.0,
      "step": 9781,
      "turn_loss": 0.24762850999832153,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.4544694294740754,
      "grad_norm": 0.7579870820045471,
      "learning_rate": 8.364184686847226e-07,
      "loss": 0.1207,
      "mae_dtheta": 0.04307897016406059,
      "mae_dx": 0.008038639090955257,
      "mae_dy": 0.0031270626932382584,
      "pose_mae_dtheta": 0.3733891546726227,
      "pose_mae_dx": 0.05942344292998314,
      "pose_mae_dy": 0.04018360376358032,
      "pose_rmse_dtheta": 0.6640388369560242,
      "pose_rmse_dx": 0.1615685671567917,
      "pose_rmse_dy": 0.11313614249229431,
      "pose_rmse_mean": 0.31291455030441284,
      "rmse_dtheta": 0.06653505563735962,
      "rmse_dx": 0.01915033347904682,
      "rmse_dy": 0.006745460908859968,
      "rmse_mean": 0.03081028163433075,
      "rotation_flip": 0.015625,
      "sparse_tokens": 5673.0,
      "step": 9782,
      "turn_loss": 0.23030827939510345,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.45451588923991826,
      "grad_norm": 0.34665772318840027,
      "learning_rate": 8.356865017047916e-07,
      "loss": 0.091,
      "mae_dtheta": 0.009161259979009628,
      "mae_dx": 0.00205998751334846,
      "mae_dy": 0.002196325222030282,
      "pose_mae_dtheta": 0.05888838320970535,
      "pose_mae_dx": 0.02455827035009861,
      "pose_mae_dy": 0.026104874908924103,
      "pose_rmse_dtheta": 0.12273546308279037,
      "pose_rmse_dx": 0.07371644675731659,
      "pose_rmse_dy": 0.05833279341459274,
      "pose_rmse_mean": 0.0849282369017601,
      "rmse_dtheta": 0.020449623465538025,
      "rmse_dx": 0.007397015579044819,
      "rmse_dy": 0.004651627968996763,
      "rmse_mean": 0.010832755826413631,
      "rotation_flip": 0.004868913907557726,
      "sparse_tokens": 32105.0,
      "step": 9783,
      "turn_loss": 0.10657273977994919,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.45456234900576103,
      "grad_norm": 0.3062204122543335,
      "learning_rate": 8.349548259375384e-07,
      "loss": 0.0627,
      "mae_dtheta": 0.007466329261660576,
      "mae_dx": 0.0017356135649606586,
      "mae_dy": 0.00031407212372869253,
      "pose_mae_dtheta": 0.0551188588142395,
      "pose_mae_dx": 0.012675335630774498,
      "pose_mae_dy": 0.00448720483109355,
      "pose_rmse_dtheta": 0.21602784097194672,
      "pose_rmse_dx": 0.03642862290143967,
      "pose_rmse_dy": 0.015020865015685558,
      "pose_rmse_mean": 0.08915911614894867,
      "rmse_dtheta": 0.026737255975604057,
      "rmse_dx": 0.005572807043790817,
      "rmse_dy": 0.0011994745582342148,
      "rmse_mean": 0.011169846169650555,
      "rotation_flip": 0.0036153290420770645,
      "sparse_tokens": 32201.0,
      "step": 9784,
      "turn_loss": 0.04501998424530029,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4546088087716038,
      "grad_norm": 0.3315875828266144,
      "learning_rate": 8.342234414341311e-07,
      "loss": 0.0763,
      "mae_dtheta": 0.007735440507531166,
      "mae_dx": 0.0015642517246305943,
      "mae_dy": 0.0013945482205599546,
      "pose_mae_dtheta": 0.05724014341831207,
      "pose_mae_dx": 0.01703052408993244,
      "pose_mae_dy": 0.019395874813199043,
      "pose_rmse_dtheta": 0.15137222409248352,
      "pose_rmse_dx": 0.05454597994685173,
      "pose_rmse_dy": 0.05115219205617905,
      "pose_rmse_mean": 0.08569013327360153,
      "rmse_dtheta": 0.019321050494909286,
      "rmse_dx": 0.005115332081913948,
      "rmse_dy": 0.003823684761300683,
      "rmse_mean": 0.009420022368431091,
      "rotation_flip": 0.001505268388427794,
      "sparse_tokens": 32105.0,
      "step": 9785,
      "turn_loss": 0.052178286015987396,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26607.0,
      "epoch": 0.4546552685374466,
      "grad_norm": 0.5718792080879211,
      "learning_rate": 8.334923482457131e-07,
      "loss": 0.1347,
      "mae_dtheta": 0.026798563078045845,
      "mae_dx": 0.007578058168292046,
      "mae_dy": 0.004963093437254429,
      "pose_mae_dtheta": 0.18844954669475555,
      "pose_mae_dx": 0.06677597761154175,
      "pose_mae_dy": 0.058561116456985474,
      "pose_rmse_dtheta": 0.3847540318965912,
      "pose_rmse_dx": 0.15451939404010773,
      "pose_rmse_dy": 0.15823796391487122,
      "pose_rmse_mean": 0.23250381648540497,
      "rmse_dtheta": 0.045944344252347946,
      "rmse_dx": 0.0183668565005064,
      "rmse_dy": 0.009717173874378204,
      "rmse_mean": 0.0246761254966259,
      "rotation_flip": 0.00884244404733181,
      "sparse_tokens": 21542.0,
      "step": 9786,
      "turn_loss": 0.20367199182510376,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 34388.0,
      "epoch": 0.45470172830328937,
      "grad_norm": 0.5711316466331482,
      "learning_rate": 8.327615464234129e-07,
      "loss": 0.1392,
      "mae_dtheta": 0.03377065807580948,
      "mae_dx": 0.010206200182437897,
      "mae_dy": 0.005931020248681307,
      "pose_mae_dtheta": 0.25312042236328125,
      "pose_mae_dx": 0.07939379662275314,
      "pose_mae_dy": 0.06409568339586258,
      "pose_rmse_dtheta": 0.4505806863307953,
      "pose_rmse_dx": 0.17014099657535553,
      "pose_rmse_dy": 0.16229921579360962,
      "pose_rmse_mean": 0.2610069811344147,
      "rmse_dtheta": 0.05284273624420166,
      "rmse_dx": 0.02130143530666828,
      "rmse_dy": 0.01263025775551796,
      "rmse_mean": 0.028924807906150818,
      "rotation_flip": 0.01383285317569971,
      "sparse_tokens": 29268.0,
      "step": 9787,
      "turn_loss": 0.2753313183784485,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 32662.0,
      "epoch": 0.45474818806913214,
      "grad_norm": 0.6558049917221069,
      "learning_rate": 8.320310360183331e-07,
      "loss": 0.1493,
      "mae_dtheta": 0.04327025264501572,
      "mae_dx": 0.012043297290802002,
      "mae_dy": 0.007463362067937851,
      "pose_mae_dtheta": 0.3374595642089844,
      "pose_mae_dx": 0.10528039932250977,
      "pose_mae_dy": 0.08052080869674683,
      "pose_rmse_dtheta": 0.5632618069648743,
      "pose_rmse_dx": 0.23671826720237732,
      "pose_rmse_dy": 0.1909772902727127,
      "pose_rmse_mean": 0.3303191065788269,
      "rmse_dtheta": 0.06119822710752487,
      "rmse_dx": 0.02451130747795105,
      "rmse_dy": 0.016557743772864342,
      "rmse_mean": 0.034089095890522,
      "rotation_flip": 0.010376134887337685,
      "sparse_tokens": 24508.0,
      "step": 9788,
      "turn_loss": 0.363895446062088,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.4547946478349749,
      "grad_norm": 0.45737144351005554,
      "learning_rate": 8.313008170815612e-07,
      "loss": 0.1152,
      "mae_dtheta": 0.025847624987363815,
      "mae_dx": 0.008248772472143173,
      "mae_dy": 0.003945376258343458,
      "pose_mae_dtheta": 0.19447112083435059,
      "pose_mae_dx": 0.05847609415650368,
      "pose_mae_dy": 0.04627884179353714,
      "pose_rmse_dtheta": 0.35403749346733093,
      "pose_rmse_dx": 0.16426442563533783,
      "pose_rmse_dy": 0.09791649878025055,
      "pose_rmse_mean": 0.20540612936019897,
      "rmse_dtheta": 0.04228849336504936,
      "rmse_dx": 0.020382946357131004,
      "rmse_dy": 0.007312468718737364,
      "rmse_mean": 0.023327969014644623,
      "rotation_flip": 0.01610017940402031,
      "sparse_tokens": 10700.0,
      "step": 9789,
      "turn_loss": 0.17264065146446228,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4548411076008177,
      "grad_norm": 0.5432234406471252,
      "learning_rate": 8.305708896641596e-07,
      "loss": 0.0953,
      "mae_dtheta": 0.010270349681377411,
      "mae_dx": 0.0017625718610361218,
      "mae_dy": 0.001734627061523497,
      "pose_mae_dtheta": 0.06370016932487488,
      "pose_mae_dx": 0.021636124700307846,
      "pose_mae_dy": 0.023043224588036537,
      "pose_rmse_dtheta": 0.16200575232505798,
      "pose_rmse_dx": 0.07091967016458511,
      "pose_rmse_dy": 0.04719841107726097,
      "pose_rmse_mean": 0.09337460994720459,
      "rmse_dtheta": 0.022538719698786736,
      "rmse_dx": 0.007039358839392662,
      "rmse_dy": 0.0033361774403601885,
      "rmse_mean": 0.01097141858190298,
      "rotation_flip": 0.004311893600970507,
      "sparse_tokens": 32105.0,
      "step": 9790,
      "turn_loss": 0.08083008974790573,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4548875673666605,
      "grad_norm": 0.5671630501747131,
      "learning_rate": 8.298412538171735e-07,
      "loss": 0.1421,
      "mae_dtheta": 0.005871521774679422,
      "mae_dx": 0.0011756093008443713,
      "mae_dy": 0.0009164526127278805,
      "pose_mae_dtheta": 0.04228045791387558,
      "pose_mae_dx": 0.01149181742221117,
      "pose_mae_dy": 0.012378592044115067,
      "pose_rmse_dtheta": 0.15051254630088806,
      "pose_rmse_dx": 0.03222553804516792,
      "pose_rmse_dy": 0.030063506215810776,
      "pose_rmse_mean": 0.07093386352062225,
      "rmse_dtheta": 0.01799163781106472,
      "rmse_dx": 0.004214229062199593,
      "rmse_dy": 0.001946707023307681,
      "rmse_mean": 0.008050858043134212,
      "rotation_flip": 0.005524862091988325,
      "sparse_tokens": 32153.0,
      "step": 9791,
      "turn_loss": 0.042133647948503494,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.45493402713250325,
      "grad_norm": 0.5187501907348633,
      "learning_rate": 8.291119095916278e-07,
      "loss": 0.0953,
      "mae_dtheta": 0.00637271860614419,
      "mae_dx": 0.001459211576730013,
      "mae_dy": 0.0014225514605641365,
      "pose_mae_dtheta": 0.04050600156188011,
      "pose_mae_dx": 0.01777784898877144,
      "pose_mae_dy": 0.017296714708209038,
      "pose_rmse_dtheta": 0.10831107944250107,
      "pose_rmse_dx": 0.05670764297246933,
      "pose_rmse_dy": 0.04589568451046944,
      "pose_rmse_mean": 0.07030480355024338,
      "rmse_dtheta": 0.016585499048233032,
      "rmse_dx": 0.005507571157068014,
      "rmse_dy": 0.0038944550324231386,
      "rmse_mean": 0.008662508800625801,
      "rotation_flip": 0.004966887645423412,
      "sparse_tokens": 32041.0,
      "step": 9792,
      "turn_loss": 0.05097997561097145,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.454980486898346,
      "grad_norm": 0.6063650846481323,
      "learning_rate": 8.283828570385239e-07,
      "loss": 0.1403,
      "mae_dtheta": 0.007746353279799223,
      "mae_dx": 0.0010835622670128942,
      "mae_dy": 0.0018352762563154101,
      "pose_mae_dtheta": 0.04979544132947922,
      "pose_mae_dx": 0.01706649921834469,
      "pose_mae_dy": 0.020048711448907852,
      "pose_rmse_dtheta": 0.14205142855644226,
      "pose_rmse_dx": 0.040499456226825714,
      "pose_rmse_dy": 0.0467032864689827,
      "pose_rmse_mean": 0.07641805708408356,
      "rmse_dtheta": 0.017835525795817375,
      "rmse_dx": 0.003046519821509719,
      "rmse_dy": 0.0038603718858212233,
      "rmse_mean": 0.00824747234582901,
      "rotation_flip": 0.002514367923140526,
      "sparse_tokens": 32137.0,
      "step": 9793,
      "turn_loss": 0.05986902490258217,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4550269466641888,
      "grad_norm": 0.6183720827102661,
      "learning_rate": 8.276540962088469e-07,
      "loss": 0.1233,
      "mae_dtheta": 0.009347785264253616,
      "mae_dx": 0.0016435135621577501,
      "mae_dy": 0.0018752021715044975,
      "pose_mae_dtheta": 0.05557698756456375,
      "pose_mae_dx": 0.018163859844207764,
      "pose_mae_dy": 0.021330803632736206,
      "pose_rmse_dtheta": 0.1422954648733139,
      "pose_rmse_dx": 0.052269935607910156,
      "pose_rmse_dy": 0.05150837078690529,
      "pose_rmse_mean": 0.08202458918094635,
      "rmse_dtheta": 0.02100343070924282,
      "rmse_dx": 0.006217567715793848,
      "rmse_dy": 0.004693326540291309,
      "rmse_mean": 0.010638108476996422,
      "rotation_flip": 0.005358614958822727,
      "sparse_tokens": 32121.0,
      "step": 9794,
      "turn_loss": 0.0805734321475029,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4550734064300316,
      "grad_norm": 0.37574538588523865,
      "learning_rate": 8.269256271535575e-07,
      "loss": 0.0769,
      "mae_dtheta": 0.00799065362662077,
      "mae_dx": 0.0007245937013067305,
      "mae_dy": 0.0011426202254369855,
      "pose_mae_dtheta": 0.05532657727599144,
      "pose_mae_dx": 0.010226218029856682,
      "pose_mae_dy": 0.016302434727549553,
      "pose_rmse_dtheta": 0.22410747408866882,
      "pose_rmse_dx": 0.025861265137791634,
      "pose_rmse_dy": 0.04237429052591324,
      "pose_rmse_mean": 0.09744767844676971,
      "rmse_dtheta": 0.023668518289923668,
      "rmse_dx": 0.002292238175868988,
      "rmse_dy": 0.0028370702639222145,
      "rmse_mean": 0.009599275887012482,
      "rotation_flip": 0.0060240961611270905,
      "sparse_tokens": 32089.0,
      "step": 9795,
      "turn_loss": 0.05279925465583801,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.45511986619587436,
      "grad_norm": 0.6705489158630371,
      "learning_rate": 8.261974499235987e-07,
      "loss": 0.1978,
      "mae_dtheta": 0.010298436507582664,
      "mae_dx": 0.002014321507886052,
      "mae_dy": 0.0018478850834071636,
      "pose_mae_dtheta": 0.06852684170007706,
      "pose_mae_dx": 0.021765436977148056,
      "pose_mae_dy": 0.024847906082868576,
      "pose_rmse_dtheta": 0.16282899677753448,
      "pose_rmse_dx": 0.06845851987600327,
      "pose_rmse_dy": 0.061676811426877975,
      "pose_rmse_mean": 0.09765477478504181,
      "rmse_dtheta": 0.022788196802139282,
      "rmse_dx": 0.006482995580881834,
      "rmse_dy": 0.004193494096398354,
      "rmse_mean": 0.011154895648360252,
      "rotation_flip": 0.002230151556432247,
      "sparse_tokens": 32073.0,
      "step": 9796,
      "turn_loss": 0.1009979248046875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.45516632596171713,
      "grad_norm": 0.6174222230911255,
      "learning_rate": 8.254695645698935e-07,
      "loss": 0.1298,
      "mae_dtheta": 0.00819485541433096,
      "mae_dx": 0.0013779017608612776,
      "mae_dy": 0.0014794492162764072,
      "pose_mae_dtheta": 0.05474573373794556,
      "pose_mae_dx": 0.016268854960799217,
      "pose_mae_dy": 0.018415387719869614,
      "pose_rmse_dtheta": 0.15144428610801697,
      "pose_rmse_dx": 0.05044937506318092,
      "pose_rmse_dy": 0.04835081472992897,
      "pose_rmse_mean": 0.08341482281684875,
      "rmse_dtheta": 0.020359180867671967,
      "rmse_dx": 0.005014204420149326,
      "rmse_dy": 0.0036274483427405357,
      "rmse_mean": 0.009666944853961468,
      "rotation_flip": 0.002376425778493285,
      "sparse_tokens": 32089.0,
      "step": 9797,
      "turn_loss": 0.07425611466169357,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17806.0,
      "epoch": 0.4552127857275599,
      "grad_norm": 1.0101583003997803,
      "learning_rate": 8.247419711433413e-07,
      "loss": 0.267,
      "mae_dtheta": 0.04094467684626579,
      "mae_dx": 0.013649016618728638,
      "mae_dy": 0.0043480838648974895,
      "pose_mae_dtheta": 0.32683101296424866,
      "pose_mae_dx": 0.10885486006736755,
      "pose_mae_dy": 0.055103644728660583,
      "pose_rmse_dtheta": 0.5674521923065186,
      "pose_rmse_dx": 0.25337761640548706,
      "pose_rmse_dy": 0.1227528303861618,
      "pose_rmse_mean": 0.31452757120132446,
      "rmse_dtheta": 0.06017979234457016,
      "rmse_dx": 0.02722271904349327,
      "rmse_dy": 0.00851642806082964,
      "rmse_mean": 0.0319729819893837,
      "rotation_flip": 0.015950920060276985,
      "sparse_tokens": 14092.0,
      "step": 9798,
      "turn_loss": 0.3175787031650543,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.4552592454934027,
      "grad_norm": 1.2203532457351685,
      "learning_rate": 8.240146696948254e-07,
      "loss": 0.2822,
      "mae_dtheta": 0.03613942116498947,
      "mae_dx": 0.007502626162022352,
      "mae_dy": 0.008172767236828804,
      "pose_mae_dtheta": 0.26540082693099976,
      "pose_mae_dx": 0.07206270098686218,
      "pose_mae_dy": 0.048588238656520844,
      "pose_rmse_dtheta": 0.5121185779571533,
      "pose_rmse_dx": 0.14293493330478668,
      "pose_rmse_dy": 0.11146098375320435,
      "pose_rmse_mean": 0.255504846572876,
      "rmse_dtheta": 0.05894093215465546,
      "rmse_dx": 0.014656019397079945,
      "rmse_dy": 0.017463428899645805,
      "rmse_mean": 0.03035346232354641,
      "rotation_flip": 0.01729106716811657,
      "sparse_tokens": 5391.0,
      "step": 9799,
      "turn_loss": 0.29510247707366943,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 35254.0,
      "epoch": 0.4553057052592455,
      "grad_norm": 0.4507710635662079,
      "learning_rate": 8.232876602752033e-07,
      "loss": 0.1527,
      "mae_dtheta": 0.033234287053346634,
      "mae_dx": 0.010617238469421864,
      "mae_dy": 0.0037128846161067486,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4507710337638855,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.5607452392578,
      "model/head/act_norm_mean": 106.30309274655963,
      "model/head/act_norm_min": 72.3379135131836,
      "model/head/act_over_embed": 73.0524805606701,
      "model/head/grad_frac": 0.113368920981884,
      "model/head/grad_norm": 0.05110342428088188,
      "model/head/grad_zero_frac": 0.00021130300592631102,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6950168434633027,
      "model/head/update_ratio": 0.0008700328762643039,
      "model/head/weight_delta": 9.935797691345215,
      "model/head/weight_delta_rel": 0.1743033230304718,
      "model/head/weight_norm": 58.73735046386719,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42270246148109436,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42270246148109436,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42270246148109436,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29048508893260233,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06125108525156975,
      "model/modality_embedder.encoders.pose/grad_norm": 0.027610214427113533,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0008915289072319865,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1452674865722656,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10276569426059723,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969511032104492,
      "model/modality_embedder/grad_frac": 0.06125108525156975,
      "model/modality_embedder/grad_norm": 0.027610214427113533,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0008915289072319865,
      "model/modality_embedder/weight_delta": 3.1452674865722656,
      "model/modality_embedder/weight_delta_rel": 0.10276569426059723,
      "model/modality_embedder/weight_norm": 30.969511032104492,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 76.44783782958984,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.23467990024756,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.090429306030273,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.967089553950535,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07597219944000244,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03424606844782829,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012250442523509264,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.715672492980957,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.098960742354393,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95496368408203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 77.2089614868164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.01877639434979,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.623947143554688,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.505928005524623,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08264604955911636,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.037254445254802704,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012517818249762058,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4434683322906494,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11928443610668182,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.761133193969727,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.8991928100586,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.599047072957624,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.094331741333008,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.591904810591114,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08159863948822021,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03678230196237564,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011968773324042559,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.728878974914551,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.125208780169487,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.731889724731445,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.69351959228516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.41393849206349,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.569334030151367,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.839115185081834,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08364085108041763,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03770287334918976,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001258958363905549,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2035415172576904,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10948184877634048,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.94767189025879,
      "model/normalizer/grad_frac": 0.3220779299736023,
      "model/normalizer/grad_norm": 0.14518339931964874,
      "model/normalizer/grad_zero_frac": 0.0002162581222364679,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018460102146491408,
      "model/normalizer/weight_delta": 6.741101264953613,
      "model/normalizer/weight_delta_rel": 0.08682148158550262,
      "model/normalizer/weight_norm": 78.64712524414062,
      "pose_mae_dtheta": 0.26366013288497925,
      "pose_mae_dx": 0.08284691721200943,
      "pose_mae_dy": 0.04810573533177376,
      "pose_rmse_dtheta": 0.46846771240234375,
      "pose_rmse_dx": 0.19687585532665253,
      "pose_rmse_dy": 0.11132322996854782,
      "pose_rmse_mean": 0.25888895988464355,
      "rmse_dtheta": 0.05087906867265701,
      "rmse_dx": 0.022302171215415,
      "rmse_dy": 0.007243688218295574,
      "rmse_mean": 0.02680831030011177,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 26725.0,
      "step": 9800,
      "turn_loss": 0.2657220959663391,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "epoch": 0.4553057052592455,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3005807399749756,
      "eval_objectnav_nopose_mae_dtheta": 0.03929951414465904,
      "eval_objectnav_nopose_mae_dx": 0.012994726188480854,
      "eval_objectnav_nopose_mae_dy": 0.0049241818487644196,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3145833909511566,
      "eval_objectnav_nopose_pose_mae_dx": 0.10308278352022171,
      "eval_objectnav_nopose_pose_mae_dy": 0.05455370247364044,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5344484448432922,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2264484018087387,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13130341470241547,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2974001169204712,
      "eval_objectnav_nopose_rmse_dtheta": 0.05703354254364967,
      "eval_objectnav_nopose_rmse_dx": 0.025500627234578133,
      "eval_objectnav_nopose_rmse_dy": 0.010235477238893509,
      "eval_objectnav_nopose_rmse_mean": 0.03092321753501892,
      "eval_objectnav_nopose_rotation_flip": 0.015776434913277626,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3005807399749756,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 9800
    },
    {
      "epoch": 0.4553057052592455,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2701018750667572,
      "eval_objectnav_pose_mae_dtheta": 0.034923043102025986,
      "eval_objectnav_pose_mae_dx": 0.010968413203954697,
      "eval_objectnav_pose_mae_dy": 0.004764923360198736,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2633795738220215,
      "eval_objectnav_pose_pose_mae_dx": 0.0847776010632515,
      "eval_objectnav_pose_pose_mae_dy": 0.04920347034931183,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46282389760017395,
      "eval_objectnav_pose_pose_rmse_dx": 0.1971089243888855,
      "eval_objectnav_pose_pose_rmse_dy": 0.11767839640378952,
      "eval_objectnav_pose_pose_rmse_mean": 0.2592037618160248,
      "eval_objectnav_pose_rmse_dtheta": 0.05247974023222923,
      "eval_objectnav_pose_rmse_dx": 0.02298998273909092,
      "eval_objectnav_pose_rmse_dy": 0.00995645858347416,
      "eval_objectnav_pose_rmse_mean": 0.02847539447247982,
      "eval_objectnav_pose_rotation_flip": 0.01569153182208538,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2701018750667572,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 9800
    },
    {
      "epoch": 0.4553057052592455,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.0877431184053421,
      "eval_pointnav_mae_dtheta": 0.00982853677123785,
      "eval_pointnav_mae_dx": 0.002209146274253726,
      "eval_pointnav_mae_dy": 0.002301460364833474,
      "eval_pointnav_pose_mae_dtheta": 0.0673019289970398,
      "eval_pointnav_pose_mae_dx": 0.024428999051451683,
      "eval_pointnav_pose_mae_dy": 0.02452024258673191,
      "eval_pointnav_pose_rmse_dtheta": 0.19394710659980774,
      "eval_pointnav_pose_rmse_dx": 0.07775253802537918,
      "eval_pointnav_pose_rmse_dy": 0.07130184769630432,
      "eval_pointnav_pose_rmse_mean": 0.11433383077383041,
      "eval_pointnav_rmse_dtheta": 0.0245469119399786,
      "eval_pointnav_rmse_dx": 0.0072965859435498714,
      "eval_pointnav_rmse_dy": 0.00633832486346364,
      "eval_pointnav_rmse_mean": 0.012727274559438229,
      "eval_pointnav_rotation_flip": 0.004826633725315332,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.0877431184053421,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 9800
    },
    {
      "epoch": 0.4553057052592455,
      "eval_loss": 0.2194752444823583,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3005807399749756,
      "eval_objectnav_nopose_mae_dtheta": 0.03929951414465904,
      "eval_objectnav_nopose_mae_dx": 0.012994726188480854,
      "eval_objectnav_nopose_mae_dy": 0.0049241818487644196,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3145833909511566,
      "eval_objectnav_nopose_pose_mae_dx": 0.10308278352022171,
      "eval_objectnav_nopose_pose_mae_dy": 0.05455370247364044,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5344484448432922,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2264484018087387,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13130341470241547,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2974001169204712,
      "eval_objectnav_nopose_rmse_dtheta": 0.05703354254364967,
      "eval_objectnav_nopose_rmse_dx": 0.025500627234578133,
      "eval_objectnav_nopose_rmse_dy": 0.010235477238893509,
      "eval_objectnav_nopose_rmse_mean": 0.03092321753501892,
      "eval_objectnav_nopose_rotation_flip": 0.015776434913277626,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3005807399749756,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2701018750667572,
      "eval_objectnav_pose_mae_dtheta": 0.034923043102025986,
      "eval_objectnav_pose_mae_dx": 0.010968413203954697,
      "eval_objectnav_pose_mae_dy": 0.004764923360198736,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2633795738220215,
      "eval_objectnav_pose_pose_mae_dx": 0.0847776010632515,
      "eval_objectnav_pose_pose_mae_dy": 0.04920347034931183,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46282389760017395,
      "eval_objectnav_pose_pose_rmse_dx": 0.1971089243888855,
      "eval_objectnav_pose_pose_rmse_dy": 0.11767839640378952,
      "eval_objectnav_pose_pose_rmse_mean": 0.2592037618160248,
      "eval_objectnav_pose_rmse_dtheta": 0.05247974023222923,
      "eval_objectnav_pose_rmse_dx": 0.02298998273909092,
      "eval_objectnav_pose_rmse_dy": 0.00995645858347416,
      "eval_objectnav_pose_rmse_mean": 0.02847539447247982,
      "eval_objectnav_pose_rotation_flip": 0.01569153182208538,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2701018750667572,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.0877431184053421,
      "eval_pointnav_mae_dtheta": 0.00982853677123785,
      "eval_pointnav_mae_dx": 0.002209146274253726,
      "eval_pointnav_mae_dy": 0.002301460364833474,
      "eval_pointnav_pose_mae_dtheta": 0.0673019289970398,
      "eval_pointnav_pose_mae_dx": 0.024428999051451683,
      "eval_pointnav_pose_mae_dy": 0.02452024258673191,
      "eval_pointnav_pose_rmse_dtheta": 0.19394710659980774,
      "eval_pointnav_pose_rmse_dx": 0.07775253802537918,
      "eval_pointnav_pose_rmse_dy": 0.07130184769630432,
      "eval_pointnav_pose_rmse_mean": 0.11433383077383041,
      "eval_pointnav_rmse_dtheta": 0.0245469119399786,
      "eval_pointnav_rmse_dx": 0.0072965859435498714,
      "eval_pointnav_rmse_dy": 0.00633832486346364,
      "eval_pointnav_rmse_mean": 0.012727274559438229,
      "eval_pointnav_rotation_flip": 0.004826633725315332,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.0877431184053421,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 9800
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.4553521650250883,
      "grad_norm": 0.5504205822944641,
      "learning_rate": 8.225609429353187e-07,
      "loss": 0.1485,
      "mae_dtheta": 0.032722193747758865,
      "mae_dx": 0.01048941258341074,
      "mae_dy": 0.0027745780535042286,
      "pose_mae_dtheta": 0.22655954957008362,
      "pose_mae_dx": 0.08557351678609848,
      "pose_mae_dy": 0.026820285245776176,
      "pose_rmse_dtheta": 0.4160701632499695,
      "pose_rmse_dx": 0.20262902975082397,
      "pose_rmse_dy": 0.059513967484235764,
      "pose_rmse_mean": 0.2260710597038269,
      "rmse_dtheta": 0.05126297473907471,
      "rmse_dx": 0.02246168814599514,
      "rmse_dy": 0.005439025349915028,
      "rmse_mean": 0.0263878982514143,
      "rotation_flip": 0.007518797181546688,
      "sparse_tokens": 8988.0,
      "step": 9801,
      "turn_loss": 0.2624722123146057,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.4553986247909311,
      "grad_norm": 1.5005367994308472,
      "learning_rate": 8.218345177259879e-07,
      "loss": 0.2669,
      "mae_dtheta": 0.03293110057711601,
      "mae_dx": 0.011552472598850727,
      "mae_dy": 0.004535755142569542,
      "pose_mae_dtheta": 0.25202834606170654,
      "pose_mae_dx": 0.10322291404008865,
      "pose_mae_dy": 0.050065167248249054,
      "pose_rmse_dtheta": 0.4619670510292053,
      "pose_rmse_dx": 0.2562806010246277,
      "pose_rmse_dy": 0.15412147343158722,
      "pose_rmse_mean": 0.29078972339630127,
      "rmse_dtheta": 0.05035386234521866,
      "rmse_dx": 0.02520308457314968,
      "rmse_dy": 0.011541244573891163,
      "rmse_mean": 0.029032733291387558,
      "rotation_flip": 0.012706479988992214,
      "sparse_tokens": 13069.0,
      "step": 9802,
      "turn_loss": 0.24718832969665527,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.45544508455677385,
      "grad_norm": 0.4383065700531006,
      "learning_rate": 8.211083846980117e-07,
      "loss": 0.0816,
      "mae_dtheta": 0.004637440666556358,
      "mae_dx": 0.0011412804014980793,
      "mae_dy": 0.0010228550527244806,
      "pose_mae_dtheta": 0.03208274394273758,
      "pose_mae_dx": 0.012141751125454903,
      "pose_mae_dy": 0.012487618252635002,
      "pose_rmse_dtheta": 0.07433479279279709,
      "pose_rmse_dx": 0.0309053473174572,
      "pose_rmse_dy": 0.034256502985954285,
      "pose_rmse_mean": 0.04649887979030609,
      "rmse_dtheta": 0.011016576550900936,
      "rmse_dx": 0.0034204325638711452,
      "rmse_dy": 0.0024870820343494415,
      "rmse_mean": 0.005641363561153412,
      "rotation_flip": 0.0022421525791287422,
      "sparse_tokens": 32153.0,
      "step": 9803,
      "turn_loss": 0.041814327239990234,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4554915443226166,
      "grad_norm": 0.801749050617218,
      "learning_rate": 8.203825439021707e-07,
      "loss": 0.1241,
      "mae_dtheta": 0.009978664107620716,
      "mae_dx": 0.0018902452429756522,
      "mae_dy": 0.002256268635392189,
      "pose_mae_dtheta": 0.06896813958883286,
      "pose_mae_dx": 0.017772121354937553,
      "pose_mae_dy": 0.022743556648492813,
      "pose_rmse_dtheta": 0.20023898780345917,
      "pose_rmse_dx": 0.04487036168575287,
      "pose_rmse_dy": 0.052828095853328705,
      "pose_rmse_mean": 0.09931248426437378,
      "rmse_dtheta": 0.023963510990142822,
      "rmse_dx": 0.005801628343760967,
      "rmse_dy": 0.006258869078010321,
      "rmse_mean": 0.0120080029591918,
      "rotation_flip": 0.005360824521631002,
      "sparse_tokens": 32105.0,
      "step": 9804,
      "turn_loss": 0.07839140295982361,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30818.0,
      "epoch": 0.4555380040884594,
      "grad_norm": 0.5254790782928467,
      "learning_rate": 8.196569953892202e-07,
      "loss": 0.1283,
      "mae_dtheta": 0.028352804481983185,
      "mae_dx": 0.011547020636498928,
      "mae_dy": 0.005176834762096405,
      "pose_mae_dtheta": 0.20677250623703003,
      "pose_mae_dx": 0.09606190025806427,
      "pose_mae_dy": 0.05260486900806427,
      "pose_rmse_dtheta": 0.40262743830680847,
      "pose_rmse_dx": 0.22359253466129303,
      "pose_rmse_dy": 0.11291275918483734,
      "pose_rmse_mean": 0.2463775873184204,
      "rmse_dtheta": 0.04631414636969566,
      "rmse_dx": 0.023830510675907135,
      "rmse_dy": 0.010137403383851051,
      "rmse_mean": 0.026760686188936234,
      "rotation_flip": 0.012151536531746387,
      "sparse_tokens": 25819.0,
      "step": 9805,
      "turn_loss": 0.2206781953573227,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.4555844638543022,
      "grad_norm": 0.5295771956443787,
      "learning_rate": 8.189317392099011e-07,
      "loss": 0.1335,
      "mae_dtheta": 0.03222839906811714,
      "mae_dx": 0.010234936140477657,
      "mae_dy": 0.0035535250790417194,
      "pose_mae_dtheta": 0.2643183767795563,
      "pose_mae_dx": 0.0786895677447319,
      "pose_mae_dy": 0.05995263531804085,
      "pose_rmse_dtheta": 0.4625914394855499,
      "pose_rmse_dx": 0.1704937219619751,
      "pose_rmse_dy": 0.13296674191951752,
      "pose_rmse_mean": 0.25535064935684204,
      "rmse_dtheta": 0.04846400022506714,
      "rmse_dx": 0.021892203018069267,
      "rmse_dy": 0.0062073636800050735,
      "rmse_mean": 0.025521188974380493,
      "rotation_flip": 0.017921147868037224,
      "sparse_tokens": 9499.0,
      "step": 9806,
      "turn_loss": 0.2299204170703888,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.45563092362014496,
      "grad_norm": 0.6934965252876282,
      "learning_rate": 8.182067754149287e-07,
      "loss": 0.1813,
      "mae_dtheta": 0.030144693329930305,
      "mae_dx": 0.006781680043786764,
      "mae_dy": 0.00429360568523407,
      "pose_mae_dtheta": 0.20236700773239136,
      "pose_mae_dx": 0.05695468932390213,
      "pose_mae_dy": 0.04281941056251526,
      "pose_rmse_dtheta": 0.36696237325668335,
      "pose_rmse_dx": 0.11890878528356552,
      "pose_rmse_dy": 0.08958500623703003,
      "pose_rmse_mean": 0.1918187141418457,
      "rmse_dtheta": 0.04611939564347267,
      "rmse_dx": 0.015134760178625584,
      "rmse_dy": 0.008758079260587692,
      "rmse_mean": 0.023337412625551224,
      "rotation_flip": 0.013568521477282047,
      "sparse_tokens": 12205.0,
      "step": 9807,
      "turn_loss": 0.22910745441913605,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.45567738338598773,
      "grad_norm": 0.6448075771331787,
      "learning_rate": 8.174821040550019e-07,
      "loss": 0.0738,
      "mae_dtheta": 0.04037538543343544,
      "mae_dx": 0.014606622979044914,
      "mae_dy": 0.004178364761173725,
      "pose_mae_dtheta": 0.3597080111503601,
      "pose_mae_dx": 0.11621483415365219,
      "pose_mae_dy": 0.04567566514015198,
      "pose_rmse_dtheta": 0.5683210492134094,
      "pose_rmse_dx": 0.27250799536705017,
      "pose_rmse_dy": 0.10067813098430634,
      "pose_rmse_mean": 0.3138357400894165,
      "rmse_dtheta": 0.05867008492350578,
      "rmse_dx": 0.027778754010796547,
      "rmse_dy": 0.008054686710238457,
      "rmse_mean": 0.031501177698373795,
      "rotation_flip": 0.01975308731198311,
      "sparse_tokens": 6813.0,
      "step": 9808,
      "turn_loss": 0.300523579120636,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4557238431518305,
      "grad_norm": 0.765871524810791,
      "learning_rate": 8.167577251807951e-07,
      "loss": 0.1714,
      "mae_dtheta": 0.01358495932072401,
      "mae_dx": 0.002891439711675048,
      "mae_dy": 0.004486384801566601,
      "pose_mae_dtheta": 0.0914338082075119,
      "pose_mae_dx": 0.035585593432188034,
      "pose_mae_dy": 0.046771809458732605,
      "pose_rmse_dtheta": 0.20617060363292694,
      "pose_rmse_dx": 0.10139303654432297,
      "pose_rmse_dy": 0.11743901669979095,
      "pose_rmse_mean": 0.14166754484176636,
      "rmse_dtheta": 0.02820528857409954,
      "rmse_dx": 0.00986674427986145,
      "rmse_dy": 0.010860089212656021,
      "rmse_mean": 0.016310708597302437,
      "rotation_flip": 0.006428571417927742,
      "sparse_tokens": 32105.0,
      "step": 9809,
      "turn_loss": 0.13394907116889954,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4557703029176733,
      "grad_norm": 0.7450372576713562,
      "learning_rate": 8.160336388429673e-07,
      "loss": 0.1353,
      "mae_dtheta": 0.010480321943759918,
      "mae_dx": 0.0012347821611911058,
      "mae_dy": 0.0019115898758172989,
      "pose_mae_dtheta": 0.06345552951097488,
      "pose_mae_dx": 0.018791524693369865,
      "pose_mae_dy": 0.024182230234146118,
      "pose_rmse_dtheta": 0.1536637544631958,
      "pose_rmse_dx": 0.04994986206293106,
      "pose_rmse_dy": 0.05645911395549774,
      "pose_rmse_mean": 0.08669090270996094,
      "rmse_dtheta": 0.02101525291800499,
      "rmse_dx": 0.004515440668910742,
      "rmse_dy": 0.0038823899812996387,
      "rmse_mean": 0.009804361499845982,
      "rotation_flip": 0.0032822757493704557,
      "sparse_tokens": 32089.0,
      "step": 9810,
      "turn_loss": 0.0801093801856041,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26933.0,
      "epoch": 0.45581676268351606,
      "grad_norm": 0.5354214906692505,
      "learning_rate": 8.153098450921514e-07,
      "loss": 0.1414,
      "mae_dtheta": 0.02712342143058777,
      "mae_dx": 0.010985830798745155,
      "mae_dy": 0.004817336332052946,
      "pose_mae_dtheta": 0.18607370555400848,
      "pose_mae_dx": 0.09014592319726944,
      "pose_mae_dy": 0.058446310460567474,
      "pose_rmse_dtheta": 0.33036577701568604,
      "pose_rmse_dx": 0.20885513722896576,
      "pose_rmse_dy": 0.13146112859249115,
      "pose_rmse_mean": 0.22356069087982178,
      "rmse_dtheta": 0.04159141704440117,
      "rmse_dx": 0.023573137819767,
      "rmse_dy": 0.009017154574394226,
      "rmse_mean": 0.024727236479520798,
      "rotation_flip": 0.00935307890176773,
      "sparse_tokens": 21600.0,
      "step": 9811,
      "turn_loss": 0.2493583709001541,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.45586322244935884,
      "grad_norm": 0.6985706090927124,
      "learning_rate": 8.145863439789659e-07,
      "loss": 0.1871,
      "mae_dtheta": 0.04061315208673477,
      "mae_dx": 0.015023852698504925,
      "mae_dy": 0.009340757504105568,
      "pose_mae_dtheta": 0.32450729608535767,
      "pose_mae_dx": 0.13839095830917358,
      "pose_mae_dy": 0.10402633249759674,
      "pose_rmse_dtheta": 0.6082870364189148,
      "pose_rmse_dx": 0.28455179929733276,
      "pose_rmse_dy": 0.18268682062625885,
      "pose_rmse_mean": 0.35850855708122253,
      "rmse_dtheta": 0.0629875510931015,
      "rmse_dx": 0.02812734618782997,
      "rmse_dy": 0.016394050791859627,
      "rmse_mean": 0.035836316645145416,
      "rotation_flip": 0.010849909856915474,
      "sparse_tokens": 9874.0,
      "step": 9812,
      "turn_loss": 0.39349108934402466,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.4559096822152016,
      "grad_norm": 0.5566393136978149,
      "learning_rate": 8.138631355540022e-07,
      "loss": 0.1613,
      "mae_dtheta": 0.02207448147237301,
      "mae_dx": 0.008824937976896763,
      "mae_dy": 0.0037406294140964746,
      "pose_mae_dtheta": 0.15196824073791504,
      "pose_mae_dx": 0.07124821096658707,
      "pose_mae_dy": 0.03587726131081581,
      "pose_rmse_dtheta": 0.27055859565734863,
      "pose_rmse_dx": 0.14825929701328278,
      "pose_rmse_dy": 0.08337518572807312,
      "pose_rmse_mean": 0.16739770770072937,
      "rmse_dtheta": 0.0360175222158432,
      "rmse_dx": 0.017480002716183662,
      "rmse_dy": 0.007097503636032343,
      "rmse_mean": 0.020198343321681023,
      "rotation_flip": 0.007843137718737125,
      "sparse_tokens": 9398.0,
      "step": 9813,
      "turn_loss": 0.20926636457443237,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4559561419810444,
      "grad_norm": 0.6051220297813416,
      "learning_rate": 8.131402198678373e-07,
      "loss": 0.0905,
      "mae_dtheta": 0.007170252967625856,
      "mae_dx": 0.001656745676882565,
      "mae_dy": 0.002014102879911661,
      "pose_mae_dtheta": 0.048775628209114075,
      "pose_mae_dx": 0.02121526002883911,
      "pose_mae_dy": 0.020434167236089706,
      "pose_rmse_dtheta": 0.11469924449920654,
      "pose_rmse_dx": 0.06446843594312668,
      "pose_rmse_dy": 0.05878226459026337,
      "pose_rmse_mean": 0.0793166533112526,
      "rmse_dtheta": 0.016594257205724716,
      "rmse_dx": 0.004922813270241022,
      "rmse_dy": 0.004943119827657938,
      "rmse_mean": 0.008820063434541225,
      "rotation_flip": 0.0033269962295889854,
      "sparse_tokens": 32057.0,
      "step": 9814,
      "turn_loss": 0.05614690110087395,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.45600260174688717,
      "grad_norm": 0.9324644804000854,
      "learning_rate": 8.124175969710229e-07,
      "loss": 0.2518,
      "mae_dtheta": 0.02899511717259884,
      "mae_dx": 0.013186079449951649,
      "mae_dy": 0.005232391878962517,
      "pose_mae_dtheta": 0.2342863529920578,
      "pose_mae_dx": 0.10214957594871521,
      "pose_mae_dy": 0.06515694409608841,
      "pose_rmse_dtheta": 0.4185534715652466,
      "pose_rmse_dx": 0.23518361151218414,
      "pose_rmse_dy": 0.1440688520669937,
      "pose_rmse_mean": 0.2659353017807007,
      "rmse_dtheta": 0.04567979276180267,
      "rmse_dx": 0.026697559282183647,
      "rmse_dy": 0.010545304976403713,
      "rmse_mean": 0.02764088660478592,
      "rotation_flip": 0.019184652715921402,
      "sparse_tokens": 9132.0,
      "step": 9815,
      "turn_loss": 0.21476580202579498,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.45604906151273,
      "grad_norm": 0.33564338088035583,
      "learning_rate": 8.116952669140949e-07,
      "loss": 0.0946,
      "mae_dtheta": 0.0061806379817426205,
      "mae_dx": 0.0013397193979471922,
      "mae_dy": 0.0014762283535674214,
      "pose_mae_dtheta": 0.0399673692882061,
      "pose_mae_dx": 0.01764719747006893,
      "pose_mae_dy": 0.017778851091861725,
      "pose_rmse_dtheta": 0.09459785372018814,
      "pose_rmse_dx": 0.05931781604886055,
      "pose_rmse_dy": 0.04581823945045471,
      "pose_rmse_mean": 0.0665779709815979,
      "rmse_dtheta": 0.015061262995004654,
      "rmse_dx": 0.004495121072977781,
      "rmse_dy": 0.003864460391923785,
      "rmse_mean": 0.007806948386132717,
      "rotation_flip": 0.0022925264202058315,
      "sparse_tokens": 32121.0,
      "step": 9816,
      "turn_loss": 0.05775122344493866,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.4560955212785728,
      "grad_norm": 0.5945134162902832,
      "learning_rate": 8.109732297475637e-07,
      "loss": 0.0997,
      "mae_dtheta": 0.03187427669763565,
      "mae_dx": 0.011081310920417309,
      "mae_dy": 0.006242864765226841,
      "pose_mae_dtheta": 0.23493340611457825,
      "pose_mae_dx": 0.0814446434378624,
      "pose_mae_dy": 0.06979334354400635,
      "pose_rmse_dtheta": 0.41063809394836426,
      "pose_rmse_dx": 0.19337333738803864,
      "pose_rmse_dy": 0.16578063368797302,
      "pose_rmse_mean": 0.2565973699092865,
      "rmse_dtheta": 0.04848914220929146,
      "rmse_dx": 0.023396702483296394,
      "rmse_dy": 0.012941458262503147,
      "rmse_mean": 0.02827576920390129,
      "rotation_flip": 0.01244813296943903,
      "sparse_tokens": 21877.0,
      "step": 9817,
      "turn_loss": 0.2766144275665283,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.45614198104441556,
      "grad_norm": 0.3991810083389282,
      "learning_rate": 8.10251485521924e-07,
      "loss": 0.0966,
      "mae_dtheta": 0.009644187986850739,
      "mae_dx": 0.0019168560393154621,
      "mae_dy": 0.002092208946123719,
      "pose_mae_dtheta": 0.06212567538022995,
      "pose_mae_dx": 0.019312817603349686,
      "pose_mae_dy": 0.022081708535552025,
      "pose_rmse_dtheta": 0.17984016239643097,
      "pose_rmse_dx": 0.055827558040618896,
      "pose_rmse_dy": 0.05161191523075104,
      "pose_rmse_mean": 0.09575988352298737,
      "rmse_dtheta": 0.024390237405896187,
      "rmse_dx": 0.00628100149333477,
      "rmse_dy": 0.005138110369443893,
      "rmse_mean": 0.011936450377106667,
      "rotation_flip": 0.0039032006170600653,
      "sparse_tokens": 32105.0,
      "step": 9818,
      "turn_loss": 0.0809079259634018,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.45618844081025833,
      "grad_norm": 0.4012453854084015,
      "learning_rate": 8.095300342876455e-07,
      "loss": 0.1024,
      "mae_dtheta": 0.010064743459224701,
      "mae_dx": 0.0014169447822496295,
      "mae_dy": 0.002027724636718631,
      "pose_mae_dtheta": 0.06815078109502792,
      "pose_mae_dx": 0.015750804916024208,
      "pose_mae_dy": 0.025790764018893242,
      "pose_rmse_dtheta": 0.1920948177576065,
      "pose_rmse_dx": 0.04251307249069214,
      "pose_rmse_dy": 0.060637153685092926,
      "pose_rmse_mean": 0.09841501712799072,
      "rmse_dtheta": 0.023437850177288055,
      "rmse_dx": 0.004093747586011887,
      "rmse_dy": 0.004221768118441105,
      "rmse_mean": 0.010584454983472824,
      "rotation_flip": 0.005683836527168751,
      "sparse_tokens": 32137.0,
      "step": 9819,
      "turn_loss": 0.08052872121334076,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.4562349005761011,
      "grad_norm": 0.44528040289878845,
      "learning_rate": 8.088088760951824e-07,
      "loss": 0.1281,
      "mae_dtheta": 0.034722741693258286,
      "mae_dx": 0.009351478889584541,
      "mae_dy": 0.005461761262267828,
      "pose_mae_dtheta": 0.25999560952186584,
      "pose_mae_dx": 0.059694863855838776,
      "pose_mae_dy": 0.06075756251811981,
      "pose_rmse_dtheta": 0.46157944202423096,
      "pose_rmse_dx": 0.13046762347221375,
      "pose_rmse_dy": 0.16314814984798431,
      "pose_rmse_mean": 0.2517317533493042,
      "rmse_dtheta": 0.05361095443367958,
      "rmse_dx": 0.01880798675119877,
      "rmse_dy": 0.012293500825762749,
      "rmse_mean": 0.02823748253285885,
      "rotation_flip": 0.008676789700984955,
      "sparse_tokens": 25088.0,
      "step": 9820,
      "turn_loss": 0.2544885575771332,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 30819.0,
      "epoch": 0.4562813603419439,
      "grad_norm": 0.8339749574661255,
      "learning_rate": 8.08088010994963e-07,
      "loss": 0.2785,
      "mae_dtheta": 0.02907506562769413,
      "mae_dx": 0.007994106970727444,
      "mae_dy": 0.0062077962793409824,
      "pose_mae_dtheta": 0.20461305975914001,
      "pose_mae_dx": 0.060962919145822525,
      "pose_mae_dy": 0.05862945690751076,
      "pose_rmse_dtheta": 0.4226810336112976,
      "pose_rmse_dx": 0.15126746892929077,
      "pose_rmse_dy": 0.13084743916988373,
      "pose_rmse_mean": 0.23493199050426483,
      "rmse_dtheta": 0.0489775575697422,
      "rmse_dx": 0.0191945917904377,
      "rmse_dy": 0.013342932797968388,
      "rmse_mean": 0.027171693742275238,
      "rotation_flip": 0.015120275318622589,
      "sparse_tokens": 24948.0,
      "step": 9821,
      "turn_loss": 0.25167375802993774,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.45632782010778666,
      "grad_norm": 0.4581771492958069,
      "learning_rate": 8.073674390373987e-07,
      "loss": 0.1139,
      "mae_dtheta": 0.0382535457611084,
      "mae_dx": 0.013690400868654251,
      "mae_dy": 0.006070200353860855,
      "pose_mae_dtheta": 0.32564157247543335,
      "pose_mae_dx": 0.08756990730762482,
      "pose_mae_dy": 0.06996200978755951,
      "pose_rmse_dtheta": 0.5653136372566223,
      "pose_rmse_dx": 0.21746690571308136,
      "pose_rmse_dy": 0.19572514295578003,
      "pose_rmse_mean": 0.32616856694221497,
      "rmse_dtheta": 0.05837571620941162,
      "rmse_dx": 0.027706792578101158,
      "rmse_dy": 0.015022605657577515,
      "rmse_mean": 0.03370170667767525,
      "rotation_flip": 0.00913621298968792,
      "sparse_tokens": 21442.0,
      "step": 9822,
      "turn_loss": 0.283797949552536,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.45637427987362944,
      "grad_norm": 0.38218942284584045,
      "learning_rate": 8.066471602728804e-07,
      "loss": 0.1127,
      "mae_dtheta": 0.009068986400961876,
      "mae_dx": 0.0012793298810720444,
      "mae_dy": 0.0017462584655731916,
      "pose_mae_dtheta": 0.05779168754816055,
      "pose_mae_dx": 0.014865444041788578,
      "pose_mae_dy": 0.02149210311472416,
      "pose_rmse_dtheta": 0.11768440902233124,
      "pose_rmse_dx": 0.03170835226774216,
      "pose_rmse_dy": 0.0473940335214138,
      "pose_rmse_mean": 0.0655955970287323,
      "rmse_dtheta": 0.019172994419932365,
      "rmse_dx": 0.0036076297983527184,
      "rmse_dy": 0.0037984331138432026,
      "rmse_mean": 0.008859685622155666,
      "rotation_flip": 0.00492437556385994,
      "sparse_tokens": 32169.0,
      "step": 9823,
      "turn_loss": 0.06660661101341248,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.4564207396394722,
      "grad_norm": 0.527256429195404,
      "learning_rate": 8.05927174751776e-07,
      "loss": 0.124,
      "mae_dtheta": 0.031578097492456436,
      "mae_dx": 0.007658003829419613,
      "mae_dy": 0.004637145437300205,
      "pose_mae_dtheta": 0.27058032155036926,
      "pose_mae_dx": 0.07748684287071228,
      "pose_mae_dy": 0.06228416785597801,
      "pose_rmse_dtheta": 0.5067169666290283,
      "pose_rmse_dx": 0.15853866934776306,
      "pose_rmse_dy": 0.15179073810577393,
      "pose_rmse_mean": 0.2723488211631775,
      "rmse_dtheta": 0.053008973598480225,
      "rmse_dx": 0.017024517059326172,
      "rmse_dy": 0.008796635083854198,
      "rmse_mean": 0.026276707649230957,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 7000.0,
      "step": 9824,
      "turn_loss": 0.25653356313705444,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.456467199405315,
      "grad_norm": 0.8608583807945251,
      "learning_rate": 8.052074825244371e-07,
      "loss": 0.1961,
      "mae_dtheta": 0.028840312734246254,
      "mae_dx": 0.011973598040640354,
      "mae_dy": 0.0048875887878239155,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8608584403991699,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.96095275878906,
      "model/head/act_norm_mean": 106.04386393229167,
      "model/head/act_norm_min": 72.11180114746094,
      "model/head/act_over_embed": 72.87433609256676,
      "model/head/grad_frac": 0.09903720021247864,
      "model/head/grad_norm": 0.08525700867176056,
      "model/head/grad_zero_frac": 0.00018655580061022192,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6987072172619048,
      "model/head/update_ratio": 0.0014514907961711287,
      "model/head/weight_delta": 9.937420845031738,
      "model/head/weight_delta_rel": 0.17433179914951324,
      "model/head/weight_norm": 58.737548828125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42272230982780457,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42272230982780457,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42272230982780457,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29049872890228473,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0338100902736187,
      "model/modality_embedder.encoders.pose/grad_norm": 0.02910570241510868,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.000939821416977793,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1449217796325684,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10275439918041229,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969396591186523,
      "model/modality_embedder/grad_frac": 0.0338100902736187,
      "model/modality_embedder/grad_norm": 0.02910570241510868,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.000939821416977793,
      "model/modality_embedder/weight_delta": 3.1449217796325684,
      "model/modality_embedder/weight_delta_rel": 0.10275439918041229,
      "model/modality_embedder/weight_norm": 30.969396591186523,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.94194793701172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.264454306027968,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.2380952835083,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.98755080435521,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10291170328855515,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.08859241008758545,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.003169089788571,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.716630697250366,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09899566322565079,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95516014099121,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.0828857421875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.034109563964474,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.349885940551758,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.51646510323523,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09574112296104431,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.08241955190896988,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0027693375013768673,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.44461989402771,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11932432651519775,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.7614688873291,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.15665435791016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.63665969860166,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.34470272064209,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.617752559068645,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08540542423725128,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07352197915315628,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002392330439761281,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7302451133728027,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12525464594364166,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.73236846923828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 75.103759765625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.43046402588813,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.419862747192383,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.85047168664061,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0848207026720047,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0730186179280281,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0024381817784160376,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.204704761505127,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10952159762382507,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.947978973388672,
      "model/normalizer/grad_frac": 0.3610387146472931,
      "model/normalizer/grad_norm": 0.31080323457717896,
      "model/normalizer/grad_zero_frac": 0.00022098507906775922,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003951850347220898,
      "model/normalizer/weight_delta": 6.7434892654418945,
      "model/normalizer/weight_delta_rel": 0.08685223758220673,
      "model/normalizer/weight_norm": 78.64752197265625,
      "pose_mae_dtheta": 0.21757380664348602,
      "pose_mae_dx": 0.08904007822275162,
      "pose_mae_dy": 0.04366867244243622,
      "pose_rmse_dtheta": 0.3593270778656006,
      "pose_rmse_dx": 0.21432790160179138,
      "pose_rmse_dy": 0.09751144796609879,
      "pose_rmse_mean": 0.2237221598625183,
      "rmse_dtheta": 0.0442206896841526,
      "rmse_dx": 0.024767933413386345,
      "rmse_dy": 0.008844288997352123,
      "rmse_mean": 0.0259443037211895,
      "rotation_flip": 0.0065146577544510365,
      "sparse_tokens": 11008.0,
      "step": 9825,
      "turn_loss": 0.23815195262432098,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.45651365917115777,
      "grad_norm": 0.7162414193153381,
      "learning_rate": 8.044880836411889e-07,
      "loss": 0.1446,
      "mae_dtheta": 0.026384366676211357,
      "mae_dx": 0.008014052174985409,
      "mae_dy": 0.0053066350519657135,
      "pose_mae_dtheta": 0.20774587988853455,
      "pose_mae_dx": 0.06493716686964035,
      "pose_mae_dy": 0.05624314770102501,
      "pose_rmse_dtheta": 0.3737436830997467,
      "pose_rmse_dx": 0.14052650332450867,
      "pose_rmse_dy": 0.1559257060289383,
      "pose_rmse_mean": 0.2233986258506775,
      "rmse_dtheta": 0.042280543595552444,
      "rmse_dx": 0.018314911052584648,
      "rmse_dy": 0.010686522349715233,
      "rmse_mean": 0.023760659620165825,
      "rotation_flip": 0.009009009227156639,
      "sparse_tokens": 15605.0,
      "step": 9826,
      "turn_loss": 0.2348410189151764,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.45656011893700055,
      "grad_norm": 0.43517252802848816,
      "learning_rate": 8.037689781523422e-07,
      "loss": 0.1282,
      "mae_dtheta": 0.00863632746040821,
      "mae_dx": 0.0026620631106197834,
      "mae_dy": 0.0017669928492978215,
      "pose_mae_dtheta": 0.056773580610752106,
      "pose_mae_dx": 0.027463877573609352,
      "pose_mae_dy": 0.023496516048908234,
      "pose_rmse_dtheta": 0.1708948314189911,
      "pose_rmse_dx": 0.09775521606206894,
      "pose_rmse_dy": 0.0652046948671341,
      "pose_rmse_mean": 0.11128491163253784,
      "rmse_dtheta": 0.022075679153203964,
      "rmse_dx": 0.010438928380608559,
      "rmse_dy": 0.004563822411000729,
      "rmse_mean": 0.012359477579593658,
      "rotation_flip": 0.002229654463008046,
      "sparse_tokens": 32025.0,
      "step": 9827,
      "turn_loss": 0.09776214510202408,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4566065787028433,
      "grad_norm": 0.5396004915237427,
      "learning_rate": 8.030501661081813e-07,
      "loss": 0.1054,
      "mae_dtheta": 0.011450355872511864,
      "mae_dx": 0.001419604872353375,
      "mae_dy": 0.0021386840380728245,
      "pose_mae_dtheta": 0.07175618410110474,
      "pose_mae_dx": 0.020010866224765778,
      "pose_mae_dy": 0.027525944635272026,
      "pose_rmse_dtheta": 0.1857970803976059,
      "pose_rmse_dx": 0.04602361470460892,
      "pose_rmse_dy": 0.057882338762283325,
      "pose_rmse_mean": 0.09656768292188644,
      "rmse_dtheta": 0.02362506091594696,
      "rmse_dx": 0.004357483237981796,
      "rmse_dy": 0.0040313471108675,
      "rmse_mean": 0.010671298019587994,
      "rotation_flip": 0.004907115362584591,
      "sparse_tokens": 32105.0,
      "step": 9828,
      "turn_loss": 0.08390922099351883,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4566530384686861,
      "grad_norm": 0.4169687032699585,
      "learning_rate": 8.023316475589754e-07,
      "loss": 0.0758,
      "mae_dtheta": 0.011144164949655533,
      "mae_dx": 0.0014279965544119477,
      "mae_dy": 0.001964970724657178,
      "pose_mae_dtheta": 0.0699986070394516,
      "pose_mae_dx": 0.015892405062913895,
      "pose_mae_dy": 0.024322275072336197,
      "pose_rmse_dtheta": 0.19104157388210297,
      "pose_rmse_dx": 0.041885167360305786,
      "pose_rmse_dy": 0.06450905650854111,
      "pose_rmse_mean": 0.09914526343345642,
      "rmse_dtheta": 0.02561783976852894,
      "rmse_dx": 0.004747219383716583,
      "rmse_dy": 0.004955357871949673,
      "rmse_mean": 0.011773472651839256,
      "rotation_flip": 0.007886434905230999,
      "sparse_tokens": 32121.0,
      "step": 9829,
      "turn_loss": 0.09174007922410965,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4566994982345289,
      "grad_norm": 0.4852524399757385,
      "learning_rate": 8.016134225549715e-07,
      "loss": 0.1248,
      "mae_dtheta": 0.01004231907427311,
      "mae_dx": 0.0012795869261026382,
      "mae_dy": 0.002027536276727915,
      "pose_mae_dtheta": 0.0649944394826889,
      "pose_mae_dx": 0.0164031982421875,
      "pose_mae_dy": 0.022390615195035934,
      "pose_rmse_dtheta": 0.18282043933868408,
      "pose_rmse_dx": 0.04373178258538246,
      "pose_rmse_dy": 0.04952319711446762,
      "pose_rmse_mean": 0.09202514588832855,
      "rmse_dtheta": 0.023955171927809715,
      "rmse_dx": 0.0034634219482541084,
      "rmse_dy": 0.004497187677770853,
      "rmse_mean": 0.010638594627380371,
      "rotation_flip": 0.006395786534994841,
      "sparse_tokens": 32121.0,
      "step": 9830,
      "turn_loss": 0.087164506316185,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.45674595800037165,
      "grad_norm": 0.5297316312789917,
      "learning_rate": 8.008954911463934e-07,
      "loss": 0.1586,
      "mae_dtheta": 0.009993093088269234,
      "mae_dx": 0.0016912466380745173,
      "mae_dy": 0.002649015747010708,
      "pose_mae_dtheta": 0.06290142983198166,
      "pose_mae_dx": 0.023368803784251213,
      "pose_mae_dy": 0.02801075577735901,
      "pose_rmse_dtheta": 0.14921535551548004,
      "pose_rmse_dx": 0.0666717067360878,
      "pose_rmse_dy": 0.06223646551370621,
      "pose_rmse_mean": 0.09270784258842468,
      "rmse_dtheta": 0.021825211122632027,
      "rmse_dx": 0.004843039903789759,
      "rmse_dy": 0.006728651933372021,
      "rmse_mean": 0.011132301762700081,
      "rotation_flip": 0.0035762181505560875,
      "sparse_tokens": 32073.0,
      "step": 9831,
      "turn_loss": 0.07768664509057999,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.45679241776621443,
      "grad_norm": 0.6772806644439697,
      "learning_rate": 8.001778533834486e-07,
      "loss": 0.1813,
      "mae_dtheta": 0.03996562957763672,
      "mae_dx": 0.015538089908659458,
      "mae_dy": 0.006974218878895044,
      "pose_mae_dtheta": 0.3474537134170532,
      "pose_mae_dx": 0.1379404217004776,
      "pose_mae_dy": 0.0854034274816513,
      "pose_rmse_dtheta": 0.5392685532569885,
      "pose_rmse_dx": 0.2713600993156433,
      "pose_rmse_dy": 0.18454422056674957,
      "pose_rmse_mean": 0.33172428607940674,
      "rmse_dtheta": 0.05713244900107384,
      "rmse_dx": 0.027936825528740883,
      "rmse_dy": 0.014702094718813896,
      "rmse_mean": 0.033257126808166504,
      "rotation_flip": 0.0243055559694767,
      "sparse_tokens": 9611.0,
      "step": 9832,
      "turn_loss": 0.38934487104415894,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.45683887753205726,
      "grad_norm": 0.6175901889801025,
      "learning_rate": 7.994605093163194e-07,
      "loss": 0.1519,
      "mae_dtheta": 0.03758630156517029,
      "mae_dx": 0.012066705152392387,
      "mae_dy": 0.005222163628786802,
      "pose_mae_dtheta": 0.29885080456733704,
      "pose_mae_dx": 0.09419061243534088,
      "pose_mae_dy": 0.06655587255954742,
      "pose_rmse_dtheta": 0.5332222580909729,
      "pose_rmse_dx": 0.20837262272834778,
      "pose_rmse_dy": 0.14232902228832245,
      "pose_rmse_mean": 0.29464131593704224,
      "rmse_dtheta": 0.05764863267540932,
      "rmse_dx": 0.024191856384277344,
      "rmse_dy": 0.010106366127729416,
      "rmse_mean": 0.03064895235002041,
      "rotation_flip": 0.020351527258753777,
      "sparse_tokens": 18351.0,
      "step": 9833,
      "turn_loss": 0.26301687955856323,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 34930.0,
      "epoch": 0.45688533729790004,
      "grad_norm": 0.7069469690322876,
      "learning_rate": 7.987434589951726e-07,
      "loss": 0.2355,
      "mae_dtheta": 0.03640852868556976,
      "mae_dx": 0.01096047181636095,
      "mae_dy": 0.004697124473750591,
      "pose_mae_dtheta": 0.2776965796947479,
      "pose_mae_dx": 0.08355528861284256,
      "pose_mae_dy": 0.051906295120716095,
      "pose_rmse_dtheta": 0.4782562553882599,
      "pose_rmse_dx": 0.19693230092525482,
      "pose_rmse_dy": 0.11938846856355667,
      "pose_rmse_mean": 0.26485902070999146,
      "rmse_dtheta": 0.05303366109728813,
      "rmse_dx": 0.02276536449790001,
      "rmse_dy": 0.008782416582107544,
      "rmse_mean": 0.028193814679980278,
      "rotation_flip": 0.008217446506023407,
      "sparse_tokens": 26825.0,
      "step": 9834,
      "turn_loss": 0.2646826505661011,
      "turns": 108.0,
      "turns_per_sample": 108.0
    },
    {
      "dense_tokens": 32338.0,
      "epoch": 0.4569317970637428,
      "grad_norm": 0.8877896070480347,
      "learning_rate": 7.980267024701494e-07,
      "loss": 0.27,
      "mae_dtheta": 0.030718311667442322,
      "mae_dx": 0.007794981822371483,
      "mae_dy": 0.0037899434100836515,
      "pose_mae_dtheta": 0.25012263655662537,
      "pose_mae_dx": 0.05916599556803703,
      "pose_mae_dy": 0.05191032215952873,
      "pose_rmse_dtheta": 0.48228567838668823,
      "pose_rmse_dx": 0.14272084832191467,
      "pose_rmse_dy": 0.12042059749364853,
      "pose_rmse_mean": 0.24847571551799774,
      "rmse_dtheta": 0.04994657635688782,
      "rmse_dx": 0.018642518669366837,
      "rmse_dy": 0.007214269135147333,
      "rmse_mean": 0.025267787277698517,
      "rotation_flip": 0.012093726545572281,
      "sparse_tokens": 25284.0,
      "step": 9835,
      "turn_loss": 0.2123146653175354,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4569782568295856,
      "grad_norm": 1.1535978317260742,
      "learning_rate": 7.97310239791374e-07,
      "loss": 0.2017,
      "mae_dtheta": 0.012431742623448372,
      "mae_dx": 0.0048054903745651245,
      "mae_dy": 0.00526678841561079,
      "pose_mae_dtheta": 0.09355351328849792,
      "pose_mae_dx": 0.04810386523604393,
      "pose_mae_dy": 0.03658296912908554,
      "pose_rmse_dtheta": 0.2574361264705658,
      "pose_rmse_dx": 0.1339137703180313,
      "pose_rmse_dy": 0.09646441042423248,
      "pose_rmse_mean": 0.16260477900505066,
      "rmse_dtheta": 0.027375398203730583,
      "rmse_dx": 0.012390372343361378,
      "rmse_dy": 0.013798873871564865,
      "rmse_mean": 0.017854882404208183,
      "rotation_flip": 0.006019830238074064,
      "sparse_tokens": 32137.0,
      "step": 9836,
      "turn_loss": 0.16032981872558594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.45702471659542837,
      "grad_norm": 0.9489851593971252,
      "learning_rate": 7.965940710089509e-07,
      "loss": 0.2833,
      "mae_dtheta": 0.032838769257068634,
      "mae_dx": 0.0200901310890913,
      "mae_dy": 0.004976948257535696,
      "pose_mae_dtheta": 0.29718291759490967,
      "pose_mae_dx": 0.15603779256343842,
      "pose_mae_dy": 0.0775490403175354,
      "pose_rmse_dtheta": 0.4739176630973816,
      "pose_rmse_dx": 0.3168787658214569,
      "pose_rmse_dy": 0.16003552079200745,
      "pose_rmse_mean": 0.3169439733028412,
      "rmse_dtheta": 0.04906532168388367,
      "rmse_dx": 0.034845102578401566,
      "rmse_dy": 0.008139056153595448,
      "rmse_mean": 0.030683159828186035,
      "rotation_flip": 0.010723860934376717,
      "sparse_tokens": 6555.0,
      "step": 9837,
      "turn_loss": 0.2491742968559265,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.45707117636127115,
      "grad_norm": 0.7689459323883057,
      "learning_rate": 7.958781961729589e-07,
      "loss": 0.1751,
      "mae_dtheta": 0.03443366289138794,
      "mae_dx": 0.006025698967278004,
      "mae_dy": 0.004282721318304539,
      "pose_mae_dtheta": 0.2675754427909851,
      "pose_mae_dx": 0.03767545148730278,
      "pose_mae_dy": 0.0320674404501915,
      "pose_rmse_dtheta": 0.5601495504379272,
      "pose_rmse_dx": 0.11507941782474518,
      "pose_rmse_dy": 0.06686852872371674,
      "pose_rmse_mean": 0.2473658323287964,
      "rmse_dtheta": 0.058818425983190536,
      "rmse_dx": 0.01504526473581791,
      "rmse_dy": 0.010896952822804451,
      "rmse_mean": 0.028253547847270966,
      "rotation_flip": 0.01044386439025402,
      "sparse_tokens": 6757.0,
      "step": 9838,
      "turn_loss": 0.23997773230075836,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.4571176361271139,
      "grad_norm": 0.6808821558952332,
      "learning_rate": 7.951626153334629e-07,
      "loss": 0.1456,
      "mae_dtheta": 0.03229610249400139,
      "mae_dx": 0.010347007773816586,
      "mae_dy": 0.0030753312166780233,
      "pose_mae_dtheta": 0.2337198555469513,
      "pose_mae_dx": 0.08803947269916534,
      "pose_mae_dy": 0.03727811947464943,
      "pose_rmse_dtheta": 0.45416951179504395,
      "pose_rmse_dx": 0.21165600419044495,
      "pose_rmse_dy": 0.08760158717632294,
      "pose_rmse_mean": 0.25114238262176514,
      "rmse_dtheta": 0.051698118448257446,
      "rmse_dx": 0.021788040176033974,
      "rmse_dy": 0.00615346897393465,
      "rmse_mean": 0.026546543464064598,
      "rotation_flip": 0.008305647410452366,
      "sparse_tokens": 10834.0,
      "step": 9839,
      "turn_loss": 0.19633406400680542,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4571640958929567,
      "grad_norm": 0.3080160319805145,
      "learning_rate": 7.944473285405002e-07,
      "loss": 0.085,
      "mae_dtheta": 0.0105190584436059,
      "mae_dx": 0.0030669253319501877,
      "mae_dy": 0.0032312124967575073,
      "pose_mae_dtheta": 0.0702822357416153,
      "pose_mae_dx": 0.03163042291998863,
      "pose_mae_dy": 0.029406175017356873,
      "pose_rmse_dtheta": 0.15641731023788452,
      "pose_rmse_dx": 0.07633088529109955,
      "pose_rmse_dy": 0.06552635133266449,
      "pose_rmse_mean": 0.09942485392093658,
      "rmse_dtheta": 0.022278061136603355,
      "rmse_dx": 0.007804196793586016,
      "rmse_dy": 0.00698099797591567,
      "rmse_mean": 0.012354418635368347,
      "rotation_flip": 0.005873715039342642,
      "sparse_tokens": 32153.0,
      "step": 9840,
      "turn_loss": 0.10434087365865707,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4572105556587995,
      "grad_norm": 0.5860666036605835,
      "learning_rate": 7.937323358440935e-07,
      "loss": 0.1633,
      "mae_dtheta": 0.01167090330272913,
      "mae_dx": 0.0018123124027624726,
      "mae_dy": 0.0034343155566602945,
      "pose_mae_dtheta": 0.07373201847076416,
      "pose_mae_dx": 0.021930944174528122,
      "pose_mae_dy": 0.030373424291610718,
      "pose_rmse_dtheta": 0.165782168507576,
      "pose_rmse_dx": 0.05268605053424835,
      "pose_rmse_dy": 0.063602514564991,
      "pose_rmse_mean": 0.09402357786893845,
      "rmse_dtheta": 0.02347775734961033,
      "rmse_dx": 0.004964717663824558,
      "rmse_dy": 0.007340083364397287,
      "rmse_mean": 0.011927520856261253,
      "rotation_flip": 0.005165289156138897,
      "sparse_tokens": 32105.0,
      "step": 9841,
      "turn_loss": 0.10392080992460251,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2946.0,
      "epoch": 0.45725701542464225,
      "grad_norm": 0.44368836283683777,
      "learning_rate": 7.930176372942433e-07,
      "loss": 0.0888,
      "mae_dtheta": 0.03246951475739479,
      "mae_dx": 0.01591198518872261,
      "mae_dy": 0.012824933044612408,
      "pose_mae_dtheta": 0.1800978034734726,
      "pose_mae_dx": 0.12555700540542603,
      "pose_mae_dy": 0.16942529380321503,
      "pose_rmse_dtheta": 0.24691647291183472,
      "pose_rmse_dx": 0.24857880175113678,
      "pose_rmse_dy": 0.2280322015285492,
      "pose_rmse_mean": 0.2411758154630661,
      "rmse_dtheta": 0.04135387763381004,
      "rmse_dx": 0.02998860366642475,
      "rmse_dy": 0.016323698684573174,
      "rmse_mean": 0.02922206185758114,
      "rotation_flip": 0.02054794505238533,
      "sparse_tokens": 2501.0,
      "step": 9842,
      "turn_loss": 0.3482478857040405,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.45730347519048503,
      "grad_norm": 0.5918416380882263,
      "learning_rate": 7.92303232940927e-07,
      "loss": 0.1064,
      "mae_dtheta": 0.008309748023748398,
      "mae_dx": 0.0017630738439038396,
      "mae_dy": 0.0006970465183258057,
      "pose_mae_dtheta": 0.05712137371301651,
      "pose_mae_dx": 0.013879615813493729,
      "pose_mae_dy": 0.008013307116925716,
      "pose_rmse_dtheta": 0.2055131047964096,
      "pose_rmse_dx": 0.039598170667886734,
      "pose_rmse_dy": 0.026851585134863853,
      "pose_rmse_mean": 0.09065428376197815,
      "rmse_dtheta": 0.0254217516630888,
      "rmse_dx": 0.005067052785307169,
      "rmse_dy": 0.0020270273089408875,
      "rmse_mean": 0.010838611051440239,
      "rotation_flip": 0.0036997885908931494,
      "sparse_tokens": 32217.0,
      "step": 9843,
      "turn_loss": 0.06227230280637741,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4573499349563278,
      "grad_norm": 0.4197274446487427,
      "learning_rate": 7.915891228341044e-07,
      "loss": 0.0962,
      "mae_dtheta": 0.011640223674476147,
      "mae_dx": 0.0017772060818970203,
      "mae_dy": 0.002408027183264494,
      "pose_mae_dtheta": 0.08060979098081589,
      "pose_mae_dx": 0.018758023157715797,
      "pose_mae_dy": 0.024153372272849083,
      "pose_rmse_dtheta": 0.242735356092453,
      "pose_rmse_dx": 0.04968555271625519,
      "pose_rmse_dy": 0.052184369415044785,
      "pose_rmse_mean": 0.11486843228340149,
      "rmse_dtheta": 0.02786114439368248,
      "rmse_dx": 0.005830413196235895,
      "rmse_dy": 0.006097464356571436,
      "rmse_mean": 0.013263008557260036,
      "rotation_flip": 0.0031347961630672216,
      "sparse_tokens": 32121.0,
      "step": 9844,
      "turn_loss": 0.09907437115907669,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4573963947221706,
      "grad_norm": 0.5906139016151428,
      "learning_rate": 7.908753070237124e-07,
      "loss": 0.1122,
      "mae_dtheta": 0.00962140318006277,
      "mae_dx": 0.0016562200617045164,
      "mae_dy": 0.0019172964384779334,
      "pose_mae_dtheta": 0.06381044536828995,
      "pose_mae_dx": 0.019736111164093018,
      "pose_mae_dy": 0.02112252451479435,
      "pose_rmse_dtheta": 0.18409809470176697,
      "pose_rmse_dx": 0.049609992653131485,
      "pose_rmse_dy": 0.049356818199157715,
      "pose_rmse_mean": 0.09435497224330902,
      "rmse_dtheta": 0.02359604276716709,
      "rmse_dx": 0.005083200987428427,
      "rmse_dy": 0.004594188183546066,
      "rmse_mean": 0.011091144755482674,
      "rotation_flip": 0.004141739569604397,
      "sparse_tokens": 32089.0,
      "step": 9845,
      "turn_loss": 0.08708897978067398,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.45744285448801336,
      "grad_norm": 0.6951984763145447,
      "learning_rate": 7.901617855596705e-07,
      "loss": 0.1938,
      "mae_dtheta": 0.03265929967164993,
      "mae_dx": 0.008185802027583122,
      "mae_dy": 0.005581866484135389,
      "pose_mae_dtheta": 0.2322128415107727,
      "pose_mae_dx": 0.06239476799964905,
      "pose_mae_dy": 0.05749214068055153,
      "pose_rmse_dtheta": 0.44327133893966675,
      "pose_rmse_dx": 0.13183778524398804,
      "pose_rmse_dy": 0.14108921587467194,
      "pose_rmse_mean": 0.23873278498649597,
      "rmse_dtheta": 0.0524066761136055,
      "rmse_dx": 0.01826210506260395,
      "rmse_dy": 0.010743538849055767,
      "rmse_mean": 0.02713743969798088,
      "rotation_flip": 0.02398800663650036,
      "sparse_tokens": 10364.0,
      "step": 9846,
      "turn_loss": 0.20115339756011963,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.45748931425385614,
      "grad_norm": 0.49454307556152344,
      "learning_rate": 7.894485584918737e-07,
      "loss": 0.1564,
      "mae_dtheta": 0.030800946056842804,
      "mae_dx": 0.008950521238148212,
      "mae_dy": 0.007621413562446833,
      "pose_mae_dtheta": 0.24261288344860077,
      "pose_mae_dx": 0.07907596230506897,
      "pose_mae_dy": 0.07942075282335281,
      "pose_rmse_dtheta": 0.3798992931842804,
      "pose_rmse_dx": 0.16972538828849792,
      "pose_rmse_dy": 0.1679864078760147,
      "pose_rmse_mean": 0.23920369148254395,
      "rmse_dtheta": 0.045497406274080276,
      "rmse_dx": 0.01887284591794014,
      "rmse_dy": 0.014661447145044804,
      "rmse_mean": 0.026343900710344315,
      "rotation_flip": 0.019283747300505638,
      "sparse_tokens": 5864.0,
      "step": 9847,
      "turn_loss": 0.25264257192611694,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.4575357740196989,
      "grad_norm": 1.807391881942749,
      "learning_rate": 7.887356258702001e-07,
      "loss": 0.2279,
      "mae_dtheta": 0.03219430521130562,
      "mae_dx": 0.007558408658951521,
      "mae_dy": 0.0025538867339491844,
      "pose_mae_dtheta": 0.24407722055912018,
      "pose_mae_dx": 0.049295537173748016,
      "pose_mae_dy": 0.02417580783367157,
      "pose_rmse_dtheta": 0.3946192264556885,
      "pose_rmse_dx": 0.11916432529687881,
      "pose_rmse_dy": 0.05014735460281372,
      "pose_rmse_mean": 0.18797698616981506,
      "rmse_dtheta": 0.04729238525032997,
      "rmse_dx": 0.01728839799761772,
      "rmse_dy": 0.005158175248652697,
      "rmse_mean": 0.023246321827173233,
      "rotation_flip": 0.012461058795452118,
      "sparse_tokens": 4591.0,
      "step": 9848,
      "turn_loss": 0.21118684113025665,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.45758223378554175,
      "grad_norm": 0.49189886450767517,
      "learning_rate": 7.880229877445034e-07,
      "loss": 0.1146,
      "mae_dtheta": 0.024878395721316338,
      "mae_dx": 0.007877805270254612,
      "mae_dy": 0.0036959820427000523,
      "pose_mae_dtheta": 0.1802547723054886,
      "pose_mae_dx": 0.06687682867050171,
      "pose_mae_dy": 0.03865155205130577,
      "pose_rmse_dtheta": 0.30759066343307495,
      "pose_rmse_dx": 0.14204692840576172,
      "pose_rmse_dy": 0.09524405747652054,
      "pose_rmse_mean": 0.18162721395492554,
      "rmse_dtheta": 0.038811564445495605,
      "rmse_dx": 0.017763134092092514,
      "rmse_dy": 0.007074109278619289,
      "rmse_mean": 0.021216269582509995,
      "rotation_flip": 0.012571428902447224,
      "sparse_tokens": 15269.0,
      "step": 9849,
      "turn_loss": 0.17740792036056519,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.4576286935513845,
      "grad_norm": 0.5873993635177612,
      "learning_rate": 7.873106441646206e-07,
      "loss": 0.1263,
      "mae_dtheta": 0.032907623797655106,
      "mae_dx": 0.01144548412412405,
      "mae_dy": 0.0072295586578547955,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.587399423122406,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 124.22557067871094,
      "model/head/act_norm_mean": 101.55562744140624,
      "model/head/act_norm_min": 77.35338592529297,
      "model/head/act_over_embed": 69.78997795649825,
      "model/head/grad_frac": 0.09907597303390503,
      "model/head/grad_norm": 0.05819717049598694,
      "model/head/grad_zero_frac": 0.00018465216271579266,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.699755859375,
      "model/head/update_ratio": 0.0009907963685691357,
      "model/head/weight_delta": 9.939071655273438,
      "model/head/weight_delta_rel": 0.1743607521057129,
      "model/head/weight_norm": 58.73777389526367,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42271843552589417,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42271843552589417,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42271843552589417,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2904960664457401,
      "model/modality_embedder.encoders.pose/grad_frac": 0.048884108662605286,
      "model/modality_embedder.encoders.pose/grad_norm": 0.02871449664235115,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.546875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009271908784285188,
      "model/modality_embedder.encoders.pose/weight_delta": 3.145052909851074,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10275868326425552,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96934700012207,
      "model/modality_embedder/grad_frac": 0.048884108662605286,
      "model/modality_embedder/grad_norm": 0.02871449664235115,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.546875,
      "model/modality_embedder/update_ratio": 0.0009271908784285188,
      "model/modality_embedder/weight_delta": 3.145052909851074,
      "model/modality_embedder/weight_delta_rel": 0.10275868326425552,
      "model/modality_embedder/weight_norm": 30.96934700012207,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 67.49456024169922,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.827599516369048,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.367667198181152,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.687340103002622,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06144695356488228,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.036093905568122864,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012911215890198946,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.71751070022583,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09902773052453995,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95546531677246,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 68.89613342285156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.581358506944444,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.88160514831543,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.205330338128885,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06098240986466408,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03582103177905083,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000322788895573467,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001203587744385004,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.445831060409546,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11936628073453903,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.761878967285156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 70.27567291259766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.186726500496032,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.554471969604492,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.30855425298949,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.060282301157712936,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03540978953242302,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00031270174076780677,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011521846754476428,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7316229343414307,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12530091404914856,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.732738494873047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 71.02882385253906,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.109210689484126,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.397464752197266,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.629703386242657,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05857802927494049,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.034408699721097946,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011489365715533495,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2057926654815674,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10955878347158432,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.94830322265625,
      "model/normalizer/grad_frac": 0.21456077694892883,
      "model/normalizer/grad_norm": 0.12603287398815155,
      "model/normalizer/grad_zero_frac": 0.00028952592401765287,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001602492993697524,
      "model/normalizer/weight_delta": 6.745854377746582,
      "model/normalizer/weight_delta_rel": 0.08688269555568695,
      "model/normalizer/weight_norm": 78.64800262451172,
      "pose_mae_dtheta": 0.24375595152378082,
      "pose_mae_dx": 0.10771264880895615,
      "pose_mae_dy": 0.07653246819972992,
      "pose_rmse_dtheta": 0.46536165475845337,
      "pose_rmse_dx": 0.24041123688220978,
      "pose_rmse_dy": 0.14599516987800598,
      "pose_rmse_mean": 0.2839226722717285,
      "rmse_dtheta": 0.04735925421118736,
      "rmse_dx": 0.024262685328722,
      "rmse_dy": 0.011380869895219803,
      "rmse_mean": 0.02766760252416134,
      "rotation_flip": 0.03731343150138855,
      "sparse_tokens": 5373.0,
      "step": 9850,
      "turn_loss": 0.30670982599258423,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 24338.0,
      "epoch": 0.4576751533172273,
      "grad_norm": 0.46150076389312744,
      "learning_rate": 7.865985951803646e-07,
      "loss": 0.1172,
      "mae_dtheta": 0.029970163479447365,
      "mae_dx": 0.013401343487203121,
      "mae_dy": 0.004044579342007637,
      "pose_mae_dtheta": 0.23027990758419037,
      "pose_mae_dx": 0.10482634603977203,
      "pose_mae_dy": 0.06073693931102753,
      "pose_rmse_dtheta": 0.45549771189689636,
      "pose_rmse_dx": 0.23871532082557678,
      "pose_rmse_dy": 0.15249210596084595,
      "pose_rmse_mean": 0.2822350561618805,
      "rmse_dtheta": 0.049264755100011826,
      "rmse_dx": 0.02726868912577629,
      "rmse_dy": 0.008752381429076195,
      "rmse_mean": 0.028428610414266586,
      "rotation_flip": 0.018038330599665642,
      "sparse_tokens": 18294.0,
      "step": 9851,
      "turn_loss": 0.23405466973781586,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.4577216130830701,
      "grad_norm": 0.37829628586769104,
      "learning_rate": 7.858868408415316e-07,
      "loss": 0.0812,
      "mae_dtheta": 0.03142492100596428,
      "mae_dx": 0.0069001722149550915,
      "mae_dy": 0.004579963628202677,
      "pose_mae_dtheta": 0.2181370109319687,
      "pose_mae_dx": 0.04756280034780502,
      "pose_mae_dy": 0.057518601417541504,
      "pose_rmse_dtheta": 0.4214078187942505,
      "pose_rmse_dx": 0.12248317152261734,
      "pose_rmse_dy": 0.1642414927482605,
      "pose_rmse_mean": 0.23604416847229004,
      "rmse_dtheta": 0.049666378647089005,
      "rmse_dx": 0.016649384051561356,
      "rmse_dy": 0.012569575570523739,
      "rmse_mean": 0.026295114308595657,
      "rotation_flip": 0.011644832789897919,
      "sparse_tokens": 12558.0,
      "step": 9852,
      "turn_loss": 0.2341139018535614,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.45776807284891285,
      "grad_norm": 0.3399146795272827,
      "learning_rate": 7.851753811978924e-07,
      "loss": 0.0891,
      "mae_dtheta": 0.03376451134681702,
      "mae_dx": 0.010966131463646889,
      "mae_dy": 0.005018077790737152,
      "pose_mae_dtheta": 0.28410083055496216,
      "pose_mae_dx": 0.08639431744813919,
      "pose_mae_dy": 0.0578061118721962,
      "pose_rmse_dtheta": 0.48799270391464233,
      "pose_rmse_dx": 0.19819509983062744,
      "pose_rmse_dy": 0.12476109713315964,
      "pose_rmse_mean": 0.27031630277633667,
      "rmse_dtheta": 0.05095339193940163,
      "rmse_dx": 0.02321324683725834,
      "rmse_dy": 0.009256784804165363,
      "rmse_mean": 0.0278078094124794,
      "rotation_flip": 0.02097902074456215,
      "sparse_tokens": 11068.0,
      "step": 9853,
      "turn_loss": 0.2594407796859741,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 9111.0,
      "epoch": 0.45781453261475563,
      "grad_norm": 1.130252718925476,
      "learning_rate": 7.844642162992022e-07,
      "loss": 0.2879,
      "mae_dtheta": 0.044376153498888016,
      "mae_dx": 0.008615192025899887,
      "mae_dy": 0.001989370444789529,
      "pose_mae_dtheta": 0.3774764835834503,
      "pose_mae_dx": 0.06692294776439667,
      "pose_mae_dy": 0.023771250620484352,
      "pose_rmse_dtheta": 0.595645010471344,
      "pose_rmse_dx": 0.14009515941143036,
      "pose_rmse_dy": 0.057163093239068985,
      "pose_rmse_mean": 0.2643011212348938,
      "rmse_dtheta": 0.062432579696178436,
      "rmse_dx": 0.01818734034895897,
      "rmse_dy": 0.004566980060189962,
      "rmse_mean": 0.0283956341445446,
      "rotation_flip": 0.016632016748189926,
      "sparse_tokens": 6766.0,
      "step": 9854,
      "turn_loss": 0.25585252046585083,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.4578609923805984,
      "grad_norm": 0.7141558527946472,
      "learning_rate": 7.837533461951913e-07,
      "loss": 0.1147,
      "mae_dtheta": 0.03599493205547333,
      "mae_dx": 0.0067678350023925304,
      "mae_dy": 0.004057581070810556,
      "pose_mae_dtheta": 0.27500486373901367,
      "pose_mae_dx": 0.05442001670598984,
      "pose_mae_dy": 0.03721734881401062,
      "pose_rmse_dtheta": 0.46553751826286316,
      "pose_rmse_dx": 0.1486504226922989,
      "pose_rmse_dy": 0.09670868515968323,
      "pose_rmse_mean": 0.23696553707122803,
      "rmse_dtheta": 0.05373149737715721,
      "rmse_dx": 0.016437433660030365,
      "rmse_dy": 0.010550232604146004,
      "rmse_mean": 0.026906386017799377,
      "rotation_flip": 0.013485477305948734,
      "sparse_tokens": 15379.0,
      "step": 9855,
      "turn_loss": 0.2828608453273773,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4579074521464412,
      "grad_norm": 0.4642314612865448,
      "learning_rate": 7.830427709355726e-07,
      "loss": 0.1067,
      "mae_dtheta": 0.00906782690435648,
      "mae_dx": 0.0013959354255348444,
      "mae_dy": 0.0017933088820427656,
      "pose_mae_dtheta": 0.06603679805994034,
      "pose_mae_dx": 0.017777353525161743,
      "pose_mae_dy": 0.021221742033958435,
      "pose_rmse_dtheta": 0.19690167903900146,
      "pose_rmse_dx": 0.046562857925891876,
      "pose_rmse_dy": 0.05418326333165169,
      "pose_rmse_mean": 0.09921593964099884,
      "rmse_dtheta": 0.022326448932290077,
      "rmse_dx": 0.0041842530481517315,
      "rmse_dy": 0.00394322257488966,
      "rmse_mean": 0.01015130802989006,
      "rotation_flip": 0.006199147552251816,
      "sparse_tokens": 32121.0,
      "step": 9856,
      "turn_loss": 0.06718470901250839,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.45795391191228396,
      "grad_norm": 0.5149183869361877,
      "learning_rate": 7.823324905700352e-07,
      "loss": 0.0984,
      "mae_dtheta": 0.03719095513224602,
      "mae_dx": 0.011049505323171616,
      "mae_dy": 0.005940874107182026,
      "pose_mae_dtheta": 0.2777469754219055,
      "pose_mae_dx": 0.0979984924197197,
      "pose_mae_dy": 0.10295499116182327,
      "pose_rmse_dtheta": 0.4558228850364685,
      "pose_rmse_dx": 0.2039000391960144,
      "pose_rmse_dy": 0.23660516738891602,
      "pose_rmse_mean": 0.2987760305404663,
      "rmse_dtheta": 0.05270964279770851,
      "rmse_dx": 0.02306225337088108,
      "rmse_dy": 0.01284809596836567,
      "rmse_mean": 0.02953999862074852,
      "rotation_flip": 0.0077220075763762,
      "sparse_tokens": 9137.0,
      "step": 9857,
      "turn_loss": 0.31636756658554077,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 3915.0,
      "epoch": 0.45800037167812674,
      "grad_norm": 0.7013390064239502,
      "learning_rate": 7.816225051482518e-07,
      "loss": 0.1254,
      "mae_dtheta": 0.026075558736920357,
      "mae_dx": 0.01239037699997425,
      "mae_dy": 0.006386101711541414,
      "pose_mae_dtheta": 0.1901906281709671,
      "pose_mae_dx": 0.12200212478637695,
      "pose_mae_dy": 0.13525639474391937,
      "pose_rmse_dtheta": 0.3048553764820099,
      "pose_rmse_dx": 0.255317747592926,
      "pose_rmse_dy": 0.24194251000881195,
      "pose_rmse_mean": 0.26737189292907715,
      "rmse_dtheta": 0.03494149073958397,
      "rmse_dx": 0.026052003726363182,
      "rmse_dy": 0.008947922848165035,
      "rmse_mean": 0.02331380546092987,
      "rotation_flip": 0.024752475321292877,
      "sparse_tokens": 3182.0,
      "step": 9858,
      "turn_loss": 0.21789829432964325,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.4580468314439695,
      "grad_norm": 0.6693061590194702,
      "learning_rate": 7.809128147198692e-07,
      "loss": 0.1745,
      "mae_dtheta": 0.02631242759525776,
      "mae_dx": 0.004880198743194342,
      "mae_dy": 0.007755753118544817,
      "pose_mae_dtheta": 0.16748666763305664,
      "pose_mae_dx": 0.041018567979335785,
      "pose_mae_dy": 0.08590411394834518,
      "pose_rmse_dtheta": 0.29068443179130554,
      "pose_rmse_dx": 0.09231352806091309,
      "pose_rmse_dy": 0.17159906029701233,
      "pose_rmse_mean": 0.18486568331718445,
      "rmse_dtheta": 0.04085332155227661,
      "rmse_dx": 0.012679018080234528,
      "rmse_dy": 0.016420753672719002,
      "rmse_mean": 0.023317698389291763,
      "rotation_flip": 0.01534526888281107,
      "sparse_tokens": 8742.0,
      "step": 9859,
      "turn_loss": 0.24973036348819733,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4580932912098123,
      "grad_norm": 0.4494055211544037,
      "learning_rate": 7.802034193345182e-07,
      "loss": 0.1094,
      "mae_dtheta": 0.008715245872735977,
      "mae_dx": 0.002067775232717395,
      "mae_dy": 0.00253109959885478,
      "pose_mae_dtheta": 0.05469343438744545,
      "pose_mae_dx": 0.022596338763833046,
      "pose_mae_dy": 0.022878175601363182,
      "pose_rmse_dtheta": 0.12313991785049438,
      "pose_rmse_dx": 0.06197865307331085,
      "pose_rmse_dy": 0.04980843886733055,
      "pose_rmse_mean": 0.07830900698900223,
      "rmse_dtheta": 0.018450694158673286,
      "rmse_dx": 0.006486875936388969,
      "rmse_dy": 0.006176600232720375,
      "rmse_mean": 0.010371390730142593,
      "rotation_flip": 0.00625279126688838,
      "sparse_tokens": 32057.0,
      "step": 9860,
      "turn_loss": 0.08036664873361588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.45813975097565507,
      "grad_norm": 0.43223610520362854,
      "learning_rate": 7.79494319041808e-07,
      "loss": 0.0975,
      "mae_dtheta": 0.011989173479378223,
      "mae_dx": 0.0012818409595638514,
      "mae_dy": 0.0023747440427541733,
      "pose_mae_dtheta": 0.07658190280199051,
      "pose_mae_dx": 0.018970981240272522,
      "pose_mae_dy": 0.027720056474208832,
      "pose_rmse_dtheta": 0.21172304451465607,
      "pose_rmse_dx": 0.061376288533210754,
      "pose_rmse_dy": 0.071145199239254,
      "pose_rmse_mean": 0.11474817991256714,
      "rmse_dtheta": 0.027290191501379013,
      "rmse_dx": 0.0035161590203642845,
      "rmse_dy": 0.006347951479256153,
      "rmse_mean": 0.012384767644107342,
      "rotation_flip": 0.0031595577020198107,
      "sparse_tokens": 32073.0,
      "step": 9861,
      "turn_loss": 0.08988495916128159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.45818621074149785,
      "grad_norm": 0.40804943442344666,
      "learning_rate": 7.787855138913248e-07,
      "loss": 0.0948,
      "mae_dtheta": 0.00862737838178873,
      "mae_dx": 0.0027271124999970198,
      "mae_dy": 0.00243463390506804,
      "pose_mae_dtheta": 0.05849543213844299,
      "pose_mae_dx": 0.021944299340248108,
      "pose_mae_dy": 0.025010354816913605,
      "pose_rmse_dtheta": 0.13925108313560486,
      "pose_rmse_dx": 0.07915826141834259,
      "pose_rmse_dy": 0.06774222105741501,
      "pose_rmse_mean": 0.09538385272026062,
      "rmse_dtheta": 0.01855328306555748,
      "rmse_dx": 0.010422473773360252,
      "rmse_dy": 0.006224557291716337,
      "rmse_mean": 0.01173343788832426,
      "rotation_flip": 0.0075107295997440815,
      "sparse_tokens": 32025.0,
      "step": 9862,
      "turn_loss": 0.0988229438662529,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.4582326705073406,
      "grad_norm": 0.8912374377250671,
      "learning_rate": 7.780770039326369e-07,
      "loss": 0.2761,
      "mae_dtheta": 0.0389413982629776,
      "mae_dx": 0.009809965267777443,
      "mae_dy": 0.0043486240319907665,
      "pose_mae_dtheta": 0.3077595829963684,
      "pose_mae_dx": 0.07309937477111816,
      "pose_mae_dy": 0.05086975172162056,
      "pose_rmse_dtheta": 0.5249646902084351,
      "pose_rmse_dx": 0.1733582615852356,
      "pose_rmse_dy": 0.12775562703609467,
      "pose_rmse_mean": 0.27535954117774963,
      "rmse_dtheta": 0.058578696101903915,
      "rmse_dx": 0.020199215039610863,
      "rmse_dy": 0.010216016322374344,
      "rmse_mean": 0.029664641246199608,
      "rotation_flip": 0.013953488320112228,
      "sparse_tokens": 19861.0,
      "step": 9863,
      "turn_loss": 0.2619606554508209,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.4582791302731834,
      "grad_norm": 0.9233201742172241,
      "learning_rate": 7.773687892152892e-07,
      "loss": 0.2924,
      "mae_dtheta": 0.03836220130324364,
      "mae_dx": 0.009795819409191608,
      "mae_dy": 0.0054470933973789215,
      "pose_mae_dtheta": 0.31681936979293823,
      "pose_mae_dx": 0.07422790676355362,
      "pose_mae_dy": 0.059203021228313446,
      "pose_rmse_dtheta": 0.5189521312713623,
      "pose_rmse_dx": 0.17095670104026794,
      "pose_rmse_dy": 0.16543345153331757,
      "pose_rmse_mean": 0.2851141095161438,
      "rmse_dtheta": 0.05697318911552429,
      "rmse_dx": 0.020045006647706032,
      "rmse_dy": 0.013406186364591122,
      "rmse_mean": 0.03014146164059639,
      "rotation_flip": 0.014541386626660824,
      "sparse_tokens": 13781.0,
      "step": 9864,
      "turn_loss": 0.32936325669288635,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.4583255900390262,
      "grad_norm": 0.34986940026283264,
      "learning_rate": 7.766608697888095e-07,
      "loss": 0.1142,
      "mae_dtheta": 0.02539285644888878,
      "mae_dx": 0.011351725086569786,
      "mae_dy": 0.0035867555998265743,
      "pose_mae_dtheta": 0.19642159342765808,
      "pose_mae_dx": 0.09727615118026733,
      "pose_mae_dy": 0.05419303849339485,
      "pose_rmse_dtheta": 0.41199609637260437,
      "pose_rmse_dx": 0.24082115292549133,
      "pose_rmse_dy": 0.14762985706329346,
      "pose_rmse_mean": 0.266815721988678,
      "rmse_dtheta": 0.04453004524111748,
      "rmse_dx": 0.024956053122878075,
      "rmse_dy": 0.007938269525766373,
      "rmse_mean": 0.025808122009038925,
      "rotation_flip": 0.01879194565117359,
      "sparse_tokens": 20190.0,
      "step": 9865,
      "turn_loss": 0.24227766692638397,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.458372049804869,
      "grad_norm": 0.39814069867134094,
      "learning_rate": 7.759532457027008e-07,
      "loss": 0.0884,
      "mae_dtheta": 0.008909500204026699,
      "mae_dx": 0.0017364913364872336,
      "mae_dy": 0.0025788547936826944,
      "pose_mae_dtheta": 0.06139473617076874,
      "pose_mae_dx": 0.022641023620963097,
      "pose_mae_dy": 0.02643652632832527,
      "pose_rmse_dtheta": 0.14783954620361328,
      "pose_rmse_dx": 0.07857992500066757,
      "pose_rmse_dy": 0.0728495866060257,
      "pose_rmse_mean": 0.09975636005401611,
      "rmse_dtheta": 0.019884582608938217,
      "rmse_dx": 0.005428193602710962,
      "rmse_dy": 0.006982710678130388,
      "rmse_mean": 0.010765163227915764,
      "rotation_flip": 0.005356407258659601,
      "sparse_tokens": 32089.0,
      "step": 9866,
      "turn_loss": 0.08397315442562103,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4584185095707118,
      "grad_norm": 0.5942914485931396,
      "learning_rate": 7.752459170064491e-07,
      "loss": 0.1731,
      "mae_dtheta": 0.010480416938662529,
      "mae_dx": 0.0025577733758836985,
      "mae_dy": 0.0020083917770534754,
      "pose_mae_dtheta": 0.06900348514318466,
      "pose_mae_dx": 0.022302160039544106,
      "pose_mae_dy": 0.02097015082836151,
      "pose_rmse_dtheta": 0.21592514216899872,
      "pose_rmse_dx": 0.05605977773666382,
      "pose_rmse_dy": 0.053222138434648514,
      "pose_rmse_mean": 0.10840236395597458,
      "rmse_dtheta": 0.028269177302718163,
      "rmse_dx": 0.008315316401422024,
      "rmse_dy": 0.005460656248033047,
      "rmse_mean": 0.01401505060493946,
      "rotation_flip": 0.004081632476300001,
      "sparse_tokens": 32041.0,
      "step": 9867,
      "turn_loss": 0.13090933859348297,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.45846496933655456,
      "grad_norm": 0.41694462299346924,
      "learning_rate": 7.745388837495188e-07,
      "loss": 0.1129,
      "mae_dtheta": 0.012041148729622364,
      "mae_dx": 0.002302446635439992,
      "mae_dy": 0.003843822283670306,
      "pose_mae_dtheta": 0.07904598861932755,
      "pose_mae_dx": 0.03464237228035927,
      "pose_mae_dy": 0.03674094006419182,
      "pose_rmse_dtheta": 0.17216801643371582,
      "pose_rmse_dx": 0.09550131857395172,
      "pose_rmse_dy": 0.0866435319185257,
      "pose_rmse_mean": 0.11810427904129028,
      "rmse_dtheta": 0.024563230574131012,
      "rmse_dx": 0.005985836032778025,
      "rmse_dy": 0.008874660357832909,
      "rmse_mean": 0.013141242787241936,
      "rotation_flip": 0.0055501144379377365,
      "sparse_tokens": 32089.0,
      "step": 9868,
      "turn_loss": 0.11548144370317459,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25235.0,
      "epoch": 0.45851142910239734,
      "grad_norm": 0.42356300354003906,
      "learning_rate": 7.738321459813513e-07,
      "loss": 0.1563,
      "mae_dtheta": 0.03433489426970482,
      "mae_dx": 0.014191458001732826,
      "mae_dy": 0.009921429678797722,
      "pose_mae_dtheta": 0.27230939269065857,
      "pose_mae_dx": 0.10869018733501434,
      "pose_mae_dy": 0.09212195873260498,
      "pose_rmse_dtheta": 0.43792724609375,
      "pose_rmse_dx": 0.22149738669395447,
      "pose_rmse_dy": 0.20714999735355377,
      "pose_rmse_mean": 0.28885823488235474,
      "rmse_dtheta": 0.05115728825330734,
      "rmse_dx": 0.0257314071059227,
      "rmse_dy": 0.019623156636953354,
      "rmse_mean": 0.032170619815588,
      "rotation_flip": 0.016267122700810432,
      "sparse_tokens": 21190.0,
      "step": 9869,
      "turn_loss": 0.3591748774051666,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.4585578888682401,
      "grad_norm": 0.3573688566684723,
      "learning_rate": 7.731257037513717e-07,
      "loss": 0.0633,
      "mae_dtheta": 0.016965525224804878,
      "mae_dx": 0.0046219895593822,
      "mae_dy": 0.0024499590508639812,
      "pose_mae_dtheta": 0.12467438727617264,
      "pose_mae_dx": 0.044241439551115036,
      "pose_mae_dy": 0.04778200387954712,
      "pose_rmse_dtheta": 0.23236015439033508,
      "pose_rmse_dx": 0.11069723218679428,
      "pose_rmse_dy": 0.1116957738995552,
      "pose_rmse_mean": 0.15158438682556152,
      "rmse_dtheta": 0.030293650925159454,
      "rmse_dx": 0.013165496289730072,
      "rmse_dy": 0.004556779749691486,
      "rmse_mean": 0.01600530929863453,
      "rotation_flip": 0.012096773833036423,
      "sparse_tokens": 5056.0,
      "step": 9870,
      "turn_loss": 0.11787336319684982,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 11992.0,
      "epoch": 0.4586043486340829,
      "grad_norm": 0.8628658056259155,
      "learning_rate": 7.724195571089787e-07,
      "loss": 0.1919,
      "mae_dtheta": 0.049390118569135666,
      "mae_dx": 0.01707327365875244,
      "mae_dy": 0.013853389769792557,
      "pose_mae_dtheta": 0.3621078133583069,
      "pose_mae_dx": 0.14415092766284943,
      "pose_mae_dy": 0.1303095668554306,
      "pose_rmse_dtheta": 0.6235694885253906,
      "pose_rmse_dx": 0.2786005735397339,
      "pose_rmse_dy": 0.28315895795822144,
      "pose_rmse_mean": 0.3951096534729004,
      "rmse_dtheta": 0.06891869008541107,
      "rmse_dx": 0.03050224296748638,
      "rmse_dy": 0.027120700106024742,
      "rmse_mean": 0.04218054562807083,
      "rotation_flip": 0.006441223900765181,
      "sparse_tokens": 10036.0,
      "step": 9871,
      "turn_loss": 0.686772346496582,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 41734.0,
      "epoch": 0.45865080839992567,
      "grad_norm": 0.6118914484977722,
      "learning_rate": 7.717137061035563e-07,
      "loss": 0.1424,
      "mae_dtheta": 0.03600311651825905,
      "mae_dx": 0.011655070818960667,
      "mae_dy": 0.0039695557206869125,
      "pose_mae_dtheta": 0.2853530943393707,
      "pose_mae_dx": 0.08903385698795319,
      "pose_mae_dy": 0.04522780328989029,
      "pose_rmse_dtheta": 0.5146450996398926,
      "pose_rmse_dx": 0.1985088735818863,
      "pose_rmse_dy": 0.1115250438451767,
      "pose_rmse_mean": 0.27489301562309265,
      "rmse_dtheta": 0.05550844594836235,
      "rmse_dx": 0.023568198084831238,
      "rmse_dy": 0.010081075131893158,
      "rmse_mean": 0.029719240963459015,
      "rotation_flip": 0.008134214207530022,
      "sparse_tokens": 30034.0,
      "step": 9872,
      "turn_loss": 0.2455427199602127,
      "turns": 129.0,
      "turns_per_sample": 129.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.45869726816576845,
      "grad_norm": 0.4413965940475464,
      "learning_rate": 7.71008150784463e-07,
      "loss": 0.1148,
      "mae_dtheta": 0.012842493131756783,
      "mae_dx": 0.0020511564798653126,
      "mae_dy": 0.0030413190834224224,
      "pose_mae_dtheta": 0.0801238939166069,
      "pose_mae_dx": 0.0252554751932621,
      "pose_mae_dy": 0.031114473938941956,
      "pose_rmse_dtheta": 0.19306553900241852,
      "pose_rmse_dx": 0.06936746835708618,
      "pose_rmse_dy": 0.06619539111852646,
      "pose_rmse_mean": 0.10954280197620392,
      "rmse_dtheta": 0.026009446009993553,
      "rmse_dx": 0.007816101424396038,
      "rmse_dy": 0.007606132421642542,
      "rmse_mean": 0.01381056010723114,
      "rotation_flip": 0.005102040711790323,
      "sparse_tokens": 32073.0,
      "step": 9873,
      "turn_loss": 0.10599119961261749,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29109.0,
      "epoch": 0.4587437279316112,
      "grad_norm": 0.5441749095916748,
      "learning_rate": 7.703028912010396e-07,
      "loss": 0.1388,
      "mae_dtheta": 0.026506194844841957,
      "mae_dx": 0.010659466497600079,
      "mae_dy": 0.0035814482253044844,
      "pose_mae_dtheta": 0.19031216204166412,
      "pose_mae_dx": 0.08307944238185883,
      "pose_mae_dy": 0.04693233221769333,
      "pose_rmse_dtheta": 0.40448570251464844,
      "pose_rmse_dx": 0.2056260108947754,
      "pose_rmse_dy": 0.11424284428358078,
      "pose_rmse_mean": 0.24145153164863586,
      "rmse_dtheta": 0.04571584612131119,
      "rmse_dx": 0.023583747446537018,
      "rmse_dy": 0.007181861437857151,
      "rmse_mean": 0.025493819266557693,
      "rotation_flip": 0.008593750186264515,
      "sparse_tokens": 22434.0,
      "step": 9874,
      "turn_loss": 0.20192798972129822,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.458790187697454,
      "grad_norm": 0.49048706889152527,
      "learning_rate": 7.695979274026061e-07,
      "loss": 0.1388,
      "mae_dtheta": 0.010833874344825745,
      "mae_dx": 0.001768240937963128,
      "mae_dy": 0.0022181279491633177,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.49048709869384766,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.9420928955078,
      "model/head/act_norm_mean": 107.22297190656566,
      "model/head/act_norm_min": 55.83609390258789,
      "model/head/act_over_embed": 73.68463013147063,
      "model/head/grad_frac": 0.0958491712808609,
      "model/head/grad_norm": 0.04701278358697891,
      "model/head/grad_zero_frac": 0.0002125720784533769,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7124270044191919,
      "model/head/update_ratio": 0.000800379435531795,
      "model/head/weight_delta": 9.94062614440918,
      "model/head/weight_delta_rel": 0.17438802123069763,
      "model/head/weight_norm": 58.738121032714844,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4227777421474457,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42271549910444267,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226551651954651,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29049404850942745,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07650699466466904,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03752569481730461,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5433017713133641,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012116999132558703,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1462488174438477,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10279775410890579,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96946144104004,
      "model/modality_embedder/grad_frac": 0.07650699466466904,
      "model/modality_embedder/grad_norm": 0.03752569481730461,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5433017713133641,
      "model/modality_embedder/update_ratio": 0.0012116999132558703,
      "model/modality_embedder/weight_delta": 3.1462488174438477,
      "model/modality_embedder/weight_delta_rel": 0.10279775410890579,
      "model/modality_embedder/weight_norm": 30.96946144104004,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.49939727783203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.294387325637327,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.974746704101562,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.008121055668106,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06431777030229568,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03154703602194786,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00030765816336497664,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011284714564681053,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7183151245117188,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09905704110860825,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95554542541504,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 94.20233917236328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.205953383036718,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.280929565429688,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.634557784528855,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06309161335229874,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03094562329351902,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010397626319900155,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4469807147979736,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11940610408782959,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.7622013092041,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 96.29069519042969,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.947468233926568,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.142558097839355,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.831343094379275,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06231499835848808,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030564703047275543,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0003026145859621465,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009945242200046778,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7328991889953613,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12534376978874207,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.732988357543945,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 97.0158462524414,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.652454605579607,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.2565336227417,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.003025691313145,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05821841582655907,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.028555382043123245,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009534822311252356,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2068395614624023,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10959456115961075,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.94852066040039,
      "model/normalizer/grad_frac": 0.23530514538288116,
      "model/normalizer/grad_norm": 0.11541413515806198,
      "model/normalizer/grad_zero_frac": 0.00028007201035507023,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014674713602289557,
      "model/normalizer/weight_delta": 6.748061180114746,
      "model/normalizer/weight_delta_rel": 0.08691111952066422,
      "model/normalizer/weight_norm": 78.64830780029297,
      "pose_mae_dtheta": 0.07270463556051254,
      "pose_mae_dx": 0.024682050570845604,
      "pose_mae_dy": 0.03026333451271057,
      "pose_rmse_dtheta": 0.19118168950080872,
      "pose_rmse_dx": 0.0724598690867424,
      "pose_rmse_dy": 0.07374094426631927,
      "pose_rmse_mean": 0.11246083676815033,
      "rmse_dtheta": 0.022422200068831444,
      "rmse_dx": 0.006161597091704607,
      "rmse_dy": 0.004898739513009787,
      "rmse_mean": 0.01116084586828947,
      "rotation_flip": 0.006759611424058676,
      "sparse_tokens": 32057.0,
      "step": 9875,
      "turn_loss": 0.08697421848773956,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.4588366474632968,
      "grad_norm": 1.4878028631210327,
      "learning_rate": 7.68893259438459e-07,
      "loss": 0.264,
      "mae_dtheta": 0.03535028547048569,
      "mae_dx": 0.01968996226787567,
      "mae_dy": 0.0046638199128210545,
      "pose_mae_dtheta": 0.29920488595962524,
      "pose_mae_dx": 0.16264988481998444,
      "pose_mae_dy": 0.06816904246807098,
      "pose_rmse_dtheta": 0.5009477138519287,
      "pose_rmse_dx": 0.3280988037586212,
      "pose_rmse_dy": 0.15633507072925568,
      "pose_rmse_mean": 0.3284605145454407,
      "rmse_dtheta": 0.05297382175922394,
      "rmse_dx": 0.03404499962925911,
      "rmse_dy": 0.009034078568220139,
      "rmse_mean": 0.03201763331890106,
      "rotation_flip": 0.01643192395567894,
      "sparse_tokens": 15528.0,
      "step": 9876,
      "turn_loss": 0.272245317697525,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 15915.0,
      "epoch": 0.45888310722913955,
      "grad_norm": 0.5673591494560242,
      "learning_rate": 7.681888873578786e-07,
      "loss": 0.138,
      "mae_dtheta": 0.028248192742466927,
      "mae_dx": 0.010066712275147438,
      "mae_dy": 0.003527821507304907,
      "pose_mae_dtheta": 0.20204299688339233,
      "pose_mae_dx": 0.08269376307725906,
      "pose_mae_dy": 0.056876033544540405,
      "pose_rmse_dtheta": 0.4046099781990051,
      "pose_rmse_dx": 0.20115917921066284,
      "pose_rmse_dy": 0.16302207112312317,
      "pose_rmse_mean": 0.25626373291015625,
      "rmse_dtheta": 0.047212980687618256,
      "rmse_dx": 0.022605419158935547,
      "rmse_dy": 0.007562962826341391,
      "rmse_mean": 0.025793788954615593,
      "rotation_flip": 0.014184396713972092,
      "sparse_tokens": 12749.0,
      "step": 9877,
      "turn_loss": 0.18905554711818695,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.45892956699498233,
      "grad_norm": 0.3368861675262451,
      "learning_rate": 7.674848112101197e-07,
      "loss": 0.0676,
      "mae_dtheta": 0.007345178164541721,
      "mae_dx": 0.0010437112068757415,
      "mae_dy": 0.0013348010834306479,
      "pose_mae_dtheta": 0.04588749632239342,
      "pose_mae_dx": 0.0123744523152709,
      "pose_mae_dy": 0.018523752689361572,
      "pose_rmse_dtheta": 0.11038263142108917,
      "pose_rmse_dx": 0.03543056547641754,
      "pose_rmse_dy": 0.04209775850176811,
      "pose_rmse_mean": 0.06263698637485504,
      "rmse_dtheta": 0.017748601734638214,
      "rmse_dx": 0.0037814590614289045,
      "rmse_dy": 0.002954837866127491,
      "rmse_mean": 0.008161633275449276,
      "rotation_flip": 0.007816316559910774,
      "sparse_tokens": 32073.0,
      "step": 9878,
      "turn_loss": 0.05430122837424278,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4589760267608251,
      "grad_norm": 0.34919705986976624,
      "learning_rate": 7.667810310444191e-07,
      "loss": 0.07,
      "mae_dtheta": 0.006673826836049557,
      "mae_dx": 0.001154887257143855,
      "mae_dy": 0.0014166334876790643,
      "pose_mae_dtheta": 0.041742920875549316,
      "pose_mae_dx": 0.013188334181904793,
      "pose_mae_dy": 0.01583891548216343,
      "pose_rmse_dtheta": 0.11058177053928375,
      "pose_rmse_dx": 0.030367203056812286,
      "pose_rmse_dy": 0.03881093114614487,
      "pose_rmse_mean": 0.05991997569799423,
      "rmse_dtheta": 0.016583548858761787,
      "rmse_dx": 0.00303844572044909,
      "rmse_dy": 0.0031079703476279974,
      "rmse_mean": 0.007576655130833387,
      "rotation_flip": 0.006237006280571222,
      "sparse_tokens": 32201.0,
      "step": 9879,
      "turn_loss": 0.0530816875398159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.4590224865266679,
      "grad_norm": 0.43368685245513916,
      "learning_rate": 7.660775469099946e-07,
      "loss": 0.1139,
      "mae_dtheta": 0.030691523104906082,
      "mae_dx": 0.012201773002743721,
      "mae_dy": 0.005894223693758249,
      "pose_mae_dtheta": 0.23878730833530426,
      "pose_mae_dx": 0.10315576195716858,
      "pose_mae_dy": 0.06860769540071487,
      "pose_rmse_dtheta": 0.40917137265205383,
      "pose_rmse_dx": 0.23292438685894012,
      "pose_rmse_dy": 0.13557642698287964,
      "pose_rmse_mean": 0.2592240571975708,
      "rmse_dtheta": 0.04797680675983429,
      "rmse_dx": 0.024583108723163605,
      "rmse_dy": 0.010589373297989368,
      "rmse_mean": 0.02771643176674843,
      "rotation_flip": 0.016778523102402687,
      "sparse_tokens": 9738.0,
      "step": 9880,
      "turn_loss": 0.2796541452407837,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.45906894629251066,
      "grad_norm": 0.5205239653587341,
      "learning_rate": 7.653743588560387e-07,
      "loss": 0.0944,
      "mae_dtheta": 0.03133849427103996,
      "mae_dx": 0.014139018952846527,
      "mae_dy": 0.009517628699541092,
      "pose_mae_dtheta": 0.22708658874034882,
      "pose_mae_dx": 0.09930506348609924,
      "pose_mae_dy": 0.11032698303461075,
      "pose_rmse_dtheta": 0.3910001814365387,
      "pose_rmse_dx": 0.2038574516773224,
      "pose_rmse_dy": 0.2334219217300415,
      "pose_rmse_mean": 0.27609318494796753,
      "rmse_dtheta": 0.04730857536196709,
      "rmse_dx": 0.02706766128540039,
      "rmse_dy": 0.016782691702246666,
      "rmse_mean": 0.030386311933398247,
      "rotation_flip": 0.010183298960328102,
      "sparse_tokens": 8197.0,
      "step": 9881,
      "turn_loss": 0.2827739715576172,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4591154060583535,
      "grad_norm": 0.4503757357597351,
      "learning_rate": 7.646714669317279e-07,
      "loss": 0.108,
      "mae_dtheta": 0.010301167145371437,
      "mae_dx": 0.0021796333603560925,
      "mae_dy": 0.004134534392505884,
      "pose_mae_dtheta": 0.06363876909017563,
      "pose_mae_dx": 0.03588598594069481,
      "pose_mae_dy": 0.04027814418077469,
      "pose_rmse_dtheta": 0.12300757318735123,
      "pose_rmse_dx": 0.07949212938547134,
      "pose_rmse_dy": 0.10853301733732224,
      "pose_rmse_mean": 0.10367757081985474,
      "rmse_dtheta": 0.019503766670823097,
      "rmse_dx": 0.005484337918460369,
      "rmse_dy": 0.008813906461000443,
      "rmse_mean": 0.011267337016761303,
      "rotation_flip": 0.005197505000978708,
      "sparse_tokens": 32057.0,
      "step": 9882,
      "turn_loss": 0.12505792081356049,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.45916186582419627,
      "grad_norm": 0.43315765261650085,
      "learning_rate": 7.639688711862131e-07,
      "loss": 0.1133,
      "mae_dtheta": 0.027590570971369743,
      "mae_dx": 0.00795917958021164,
      "mae_dy": 0.004114375449717045,
      "pose_mae_dtheta": 0.2323833703994751,
      "pose_mae_dx": 0.06502935290336609,
      "pose_mae_dy": 0.04142172262072563,
      "pose_rmse_dtheta": 0.43010830879211426,
      "pose_rmse_dx": 0.13529559969902039,
      "pose_rmse_dy": 0.09330853074789047,
      "pose_rmse_mean": 0.2195708155632019,
      "rmse_dtheta": 0.04440419375896454,
      "rmse_dx": 0.017344901338219643,
      "rmse_dy": 0.007631073705852032,
      "rmse_mean": 0.023126721382141113,
      "rotation_flip": 0.01416765060275793,
      "sparse_tokens": 13848.0,
      "step": 9883,
      "turn_loss": 0.23192067444324493,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.45920832559003905,
      "grad_norm": 0.618503987789154,
      "learning_rate": 7.632665716686305e-07,
      "loss": 0.1708,
      "mae_dtheta": 0.026373427361249924,
      "mae_dx": 0.009229833260178566,
      "mae_dy": 0.005387121345847845,
      "pose_mae_dtheta": 0.19162768125534058,
      "pose_mae_dx": 0.08664271235466003,
      "pose_mae_dy": 0.054556913673877716,
      "pose_rmse_dtheta": 0.35329005122184753,
      "pose_rmse_dx": 0.20919226109981537,
      "pose_rmse_dy": 0.11295783519744873,
      "pose_rmse_mean": 0.22514671087265015,
      "rmse_dtheta": 0.04106327146291733,
      "rmse_dx": 0.020805075764656067,
      "rmse_dy": 0.009573962539434433,
      "rmse_mean": 0.02381410263478756,
      "rotation_flip": 0.008108108304440975,
      "sparse_tokens": 13015.0,
      "step": 9884,
      "turn_loss": 0.25324490666389465,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4592547853558818,
      "grad_norm": 0.3329528570175171,
      "learning_rate": 7.625645684280886e-07,
      "loss": 0.0744,
      "mae_dtheta": 0.008945593610405922,
      "mae_dx": 0.0016093382146209478,
      "mae_dy": 0.0014897658256813884,
      "pose_mae_dtheta": 0.05766601115465164,
      "pose_mae_dx": 0.018426859751343727,
      "pose_mae_dy": 0.018690353259444237,
      "pose_rmse_dtheta": 0.1513366848230362,
      "pose_rmse_dx": 0.04619479924440384,
      "pose_rmse_dy": 0.04495753347873688,
      "pose_rmse_mean": 0.0808296799659729,
      "rmse_dtheta": 0.02135479636490345,
      "rmse_dx": 0.004888523370027542,
      "rmse_dy": 0.003165631787851453,
      "rmse_mean": 0.009802984073758125,
      "rotation_flip": 0.004288164433091879,
      "sparse_tokens": 32089.0,
      "step": 9885,
      "turn_loss": 0.06645726412534714,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4593012451217246,
      "grad_norm": 0.4400690197944641,
      "learning_rate": 7.618628615136825e-07,
      "loss": 0.0833,
      "mae_dtheta": 0.009275180287659168,
      "mae_dx": 0.001570464693941176,
      "mae_dy": 0.0023537203669548035,
      "pose_mae_dtheta": 0.05653196945786476,
      "pose_mae_dx": 0.02296527847647667,
      "pose_mae_dy": 0.02721589058637619,
      "pose_rmse_dtheta": 0.10770801454782486,
      "pose_rmse_dx": 0.06170834228396416,
      "pose_rmse_dy": 0.06381881982088089,
      "pose_rmse_mean": 0.07774506509304047,
      "rmse_dtheta": 0.018343806266784668,
      "rmse_dx": 0.004354158882051706,
      "rmse_dy": 0.005262711085379124,
      "rmse_mean": 0.009320225566625595,
      "rotation_flip": 0.0024005486629903316,
      "sparse_tokens": 32137.0,
      "step": 9886,
      "turn_loss": 0.07952567934989929,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.4593477048875674,
      "grad_norm": 0.5337190628051758,
      "learning_rate": 7.611614509744802e-07,
      "loss": 0.1537,
      "mae_dtheta": 0.034674037247896194,
      "mae_dx": 0.011329855769872665,
      "mae_dy": 0.00344587373547256,
      "pose_mae_dtheta": 0.30098041892051697,
      "pose_mae_dx": 0.08300796896219254,
      "pose_mae_dy": 0.029086444526910782,
      "pose_rmse_dtheta": 0.5520342588424683,
      "pose_rmse_dx": 0.22290869057178497,
      "pose_rmse_dy": 0.08751245588064194,
      "pose_rmse_mean": 0.28748512268066406,
      "rmse_dtheta": 0.05410739779472351,
      "rmse_dx": 0.024532875046133995,
      "rmse_dy": 0.008166521787643433,
      "rmse_mean": 0.028935600072145462,
      "rotation_flip": 0.00949796475470066,
      "sparse_tokens": 14287.0,
      "step": 9887,
      "turn_loss": 0.22444002330303192,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.45939416465341015,
      "grad_norm": 0.389078289270401,
      "learning_rate": 7.604603368595336e-07,
      "loss": 0.087,
      "mae_dtheta": 0.008740310557186604,
      "mae_dx": 0.0012351586483418941,
      "mae_dy": 0.001091573853045702,
      "pose_mae_dtheta": 0.06271373480558395,
      "pose_mae_dx": 0.011488414369523525,
      "pose_mae_dy": 0.01351444236934185,
      "pose_rmse_dtheta": 0.23613755404949188,
      "pose_rmse_dx": 0.027922574430704117,
      "pose_rmse_dy": 0.037312839180231094,
      "pose_rmse_mean": 0.10045766085386276,
      "rmse_dtheta": 0.02728269249200821,
      "rmse_dx": 0.003631666535511613,
      "rmse_dy": 0.0033138657454401255,
      "rmse_mean": 0.011409408412873745,
      "rotation_flip": 0.0013550135772675276,
      "sparse_tokens": 32169.0,
      "step": 9888,
      "turn_loss": 0.050318531692028046,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.45944062441925293,
      "grad_norm": 0.425395131111145,
      "learning_rate": 7.597595192178702e-07,
      "loss": 0.0771,
      "mae_dtheta": 0.006416720803827047,
      "mae_dx": 0.0010241286363452673,
      "mae_dy": 0.0015117018483579159,
      "pose_mae_dtheta": 0.04078197851777077,
      "pose_mae_dx": 0.01382029801607132,
      "pose_mae_dy": 0.018636878579854965,
      "pose_rmse_dtheta": 0.10066992789506912,
      "pose_rmse_dx": 0.03873898461461067,
      "pose_rmse_dy": 0.05367480218410492,
      "pose_rmse_mean": 0.06436124444007874,
      "rmse_dtheta": 0.015974225476384163,
      "rmse_dx": 0.0028514303267002106,
      "rmse_dy": 0.003436562605202198,
      "rmse_mean": 0.007420740090310574,
      "rotation_flip": 0.0036764706019312143,
      "sparse_tokens": 32089.0,
      "step": 9889,
      "turn_loss": 0.05190945789217949,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.4594870841850957,
      "grad_norm": 0.8591620326042175,
      "learning_rate": 7.590589980985008e-07,
      "loss": 0.1835,
      "mae_dtheta": 0.02733818255364895,
      "mae_dx": 0.011665772646665573,
      "mae_dy": 0.006496170535683632,
      "pose_mae_dtheta": 0.20303870737552643,
      "pose_mae_dx": 0.0888439491391182,
      "pose_mae_dy": 0.07167042791843414,
      "pose_rmse_dtheta": 0.3912629187107086,
      "pose_rmse_dx": 0.1900949478149414,
      "pose_rmse_dy": 0.18138831853866577,
      "pose_rmse_mean": 0.2542487382888794,
      "rmse_dtheta": 0.04582423344254494,
      "rmse_dx": 0.022732989862561226,
      "rmse_dy": 0.01470437552779913,
      "rmse_mean": 0.027753867208957672,
      "rotation_flip": 0.013874066062271595,
      "sparse_tokens": 16480.0,
      "step": 9890,
      "turn_loss": 0.30323344469070435,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 24264.0,
      "epoch": 0.4595335439509385,
      "grad_norm": 0.5140413641929626,
      "learning_rate": 7.583587735504106e-07,
      "loss": 0.0928,
      "mae_dtheta": 0.03539485111832619,
      "mae_dx": 0.01460004411637783,
      "mae_dy": 0.004682567901909351,
      "pose_mae_dtheta": 0.28204867243766785,
      "pose_mae_dx": 0.11530162394046783,
      "pose_mae_dy": 0.054511409252882004,
      "pose_rmse_dtheta": 0.47059866786003113,
      "pose_rmse_dx": 0.26877570152282715,
      "pose_rmse_dy": 0.11889670044183731,
      "pose_rmse_mean": 0.2860903739929199,
      "rmse_dtheta": 0.053070515394210815,
      "rmse_dx": 0.028420738875865936,
      "rmse_dy": 0.009335792623460293,
      "rmse_mean": 0.030275683850049973,
      "rotation_flip": 0.01247771829366684,
      "sparse_tokens": 18380.0,
      "step": 9891,
      "turn_loss": 0.3145548105239868,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.45958000371678126,
      "grad_norm": 0.5298188328742981,
      "learning_rate": 7.576588456225686e-07,
      "loss": 0.1429,
      "mae_dtheta": 0.04896559566259384,
      "mae_dx": 0.010667270049452782,
      "mae_dy": 0.004686729982495308,
      "pose_mae_dtheta": 0.39841416478157043,
      "pose_mae_dx": 0.06447327136993408,
      "pose_mae_dy": 0.045723408460617065,
      "pose_rmse_dtheta": 0.6573885083198547,
      "pose_rmse_dx": 0.1682206392288208,
      "pose_rmse_dy": 0.143166184425354,
      "pose_rmse_mean": 0.3229251205921173,
      "rmse_dtheta": 0.06968138366937637,
      "rmse_dx": 0.02377374656498432,
      "rmse_dy": 0.01039106771349907,
      "rmse_mean": 0.034615397453308105,
      "rotation_flip": 0.013227513059973717,
      "sparse_tokens": 5962.0,
      "step": 9892,
      "turn_loss": 0.2617177665233612,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.45962646348262404,
      "grad_norm": 0.44638314843177795,
      "learning_rate": 7.569592143639198e-07,
      "loss": 0.116,
      "mae_dtheta": 0.008588050492107868,
      "mae_dx": 0.0018576659495010972,
      "mae_dy": 0.0022435260470956564,
      "pose_mae_dtheta": 0.05377643182873726,
      "pose_mae_dx": 0.018453283235430717,
      "pose_mae_dy": 0.02212398126721382,
      "pose_rmse_dtheta": 0.10871128737926483,
      "pose_rmse_dx": 0.045727141201496124,
      "pose_rmse_dy": 0.05019022896885872,
      "pose_rmse_mean": 0.06820955872535706,
      "rmse_dtheta": 0.01776670664548874,
      "rmse_dx": 0.0056014820002019405,
      "rmse_dy": 0.005299367476254702,
      "rmse_mean": 0.00955585204064846,
      "rotation_flip": 0.005506607703864574,
      "sparse_tokens": 32121.0,
      "step": 9893,
      "turn_loss": 0.0954013243317604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33413.0,
      "epoch": 0.4596729232484668,
      "grad_norm": 0.5605331063270569,
      "learning_rate": 7.562598798233923e-07,
      "loss": 0.1112,
      "mae_dtheta": 0.02867579273879528,
      "mae_dx": 0.011282901279628277,
      "mae_dy": 0.003861391684040427,
      "pose_mae_dtheta": 0.22111274302005768,
      "pose_mae_dx": 0.09193640947341919,
      "pose_mae_dy": 0.047303181141614914,
      "pose_rmse_dtheta": 0.3987022042274475,
      "pose_rmse_dx": 0.23092548549175262,
      "pose_rmse_dy": 0.11249636113643646,
      "pose_rmse_mean": 0.24737469851970673,
      "rmse_dtheta": 0.046430911868810654,
      "rmse_dx": 0.024536574259400368,
      "rmse_dy": 0.008689843118190765,
      "rmse_mean": 0.026552444323897362,
      "rotation_flip": 0.011180992238223553,
      "sparse_tokens": 26093.0,
      "step": 9894,
      "turn_loss": 0.22620177268981934,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4597193830143096,
      "grad_norm": 0.5245659947395325,
      "learning_rate": 7.555608420498872e-07,
      "loss": 0.1415,
      "mae_dtheta": 0.009021533653140068,
      "mae_dx": 0.003698995802551508,
      "mae_dy": 0.004090257920324802,
      "pose_mae_dtheta": 0.061797864735126495,
      "pose_mae_dx": 0.038675565272569656,
      "pose_mae_dy": 0.031079178676009178,
      "pose_rmse_dtheta": 0.14481095969676971,
      "pose_rmse_dx": 0.11233063787221909,
      "pose_rmse_dy": 0.08255646377801895,
      "pose_rmse_mean": 0.11323268711566925,
      "rmse_dtheta": 0.019727448001503944,
      "rmse_dx": 0.010415924713015556,
      "rmse_dy": 0.009962568990886211,
      "rmse_mean": 0.013368647545576096,
      "rotation_flip": 0.00514037162065506,
      "sparse_tokens": 32121.0,
      "step": 9895,
      "turn_loss": 0.10568813234567642,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.45976584278015237,
      "grad_norm": 0.39953452348709106,
      "learning_rate": 7.548621010922919e-07,
      "loss": 0.0766,
      "mae_dtheta": 0.011589813977479935,
      "mae_dx": 0.0010230708867311478,
      "mae_dy": 0.0018119344022125006,
      "pose_mae_dtheta": 0.07230187207460403,
      "pose_mae_dx": 0.01492427010089159,
      "pose_mae_dy": 0.023201389238238335,
      "pose_rmse_dtheta": 0.21519212424755096,
      "pose_rmse_dx": 0.03731388971209526,
      "pose_rmse_dy": 0.06072227284312248,
      "pose_rmse_mean": 0.10440942645072937,
      "rmse_dtheta": 0.028239643201231956,
      "rmse_dx": 0.0029712317045778036,
      "rmse_dy": 0.003910478670150042,
      "rmse_mean": 0.011707118712365627,
      "rotation_flip": 0.0031885213684290648,
      "sparse_tokens": 32105.0,
      "step": 9896,
      "turn_loss": 0.08756577968597412,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.45981230254599514,
      "grad_norm": 0.3089067041873932,
      "learning_rate": 7.541636569994675e-07,
      "loss": 0.0732,
      "mae_dtheta": 0.008002371527254581,
      "mae_dx": 0.0017220739973708987,
      "mae_dy": 0.0019149029394611716,
      "pose_mae_dtheta": 0.05147794261574745,
      "pose_mae_dx": 0.021301323547959328,
      "pose_mae_dy": 0.020062752068042755,
      "pose_rmse_dtheta": 0.13510246574878693,
      "pose_rmse_dx": 0.05271105468273163,
      "pose_rmse_dy": 0.04615788161754608,
      "pose_rmse_mean": 0.07799047231674194,
      "rmse_dtheta": 0.02096189372241497,
      "rmse_dx": 0.004802406765520573,
      "rmse_dy": 0.004519745707511902,
      "rmse_mean": 0.010094682686030865,
      "rotation_flip": 0.0009037505369633436,
      "sparse_tokens": 32089.0,
      "step": 9897,
      "turn_loss": 0.06700336933135986,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4598587623118379,
      "grad_norm": 0.5407812595367432,
      "learning_rate": 7.53465509820257e-07,
      "loss": 0.1006,
      "mae_dtheta": 0.008397994562983513,
      "mae_dx": 0.0021913417149335146,
      "mae_dy": 0.0027286072727292776,
      "pose_mae_dtheta": 0.06108468398451805,
      "pose_mae_dx": 0.022863801568746567,
      "pose_mae_dy": 0.03259767219424248,
      "pose_rmse_dtheta": 0.176472008228302,
      "pose_rmse_dx": 0.10212647914886475,
      "pose_rmse_dy": 0.11890770494937897,
      "pose_rmse_mean": 0.13250206410884857,
      "rmse_dtheta": 0.02190573327243328,
      "rmse_dx": 0.0106385862454772,
      "rmse_dy": 0.009842480532824993,
      "rmse_mean": 0.014128933660686016,
      "rotation_flip": 0.004909180104732513,
      "sparse_tokens": 32073.0,
      "step": 9898,
      "turn_loss": 0.08228157460689545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.45990522207768075,
      "grad_norm": 0.3195320963859558,
      "learning_rate": 7.527676596034839e-07,
      "loss": 0.0622,
      "mae_dtheta": 0.024861900135874748,
      "mae_dx": 0.008377686142921448,
      "mae_dy": 0.0019113054731860757,
      "pose_mae_dtheta": 0.19199475646018982,
      "pose_mae_dx": 0.0785280242562294,
      "pose_mae_dy": 0.017132189124822617,
      "pose_rmse_dtheta": 0.34356796741485596,
      "pose_rmse_dx": 0.21366223692893982,
      "pose_rmse_dy": 0.03507214039564133,
      "pose_rmse_mean": 0.19743412733078003,
      "rmse_dtheta": 0.0430317185819149,
      "rmse_dx": 0.01980380341410637,
      "rmse_dy": 0.004027627408504486,
      "rmse_mean": 0.02228771708905697,
      "rotation_flip": 0.005235602147877216,
      "sparse_tokens": 5393.0,
      "step": 9899,
      "turn_loss": 0.23927851021289825,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.45995168184352353,
      "grad_norm": 0.5025587677955627,
      "learning_rate": 7.520701063979475e-07,
      "loss": 0.0807,
      "mae_dtheta": 0.0073573351837694645,
      "mae_dx": 0.001755419303663075,
      "mae_dy": 0.0004841503978241235,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5025588274002075,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 164.88442993164062,
      "model/head/act_norm_mean": 130.90893308080808,
      "model/head/act_norm_min": 70.4577407836914,
      "model/head/act_over_embed": 89.96184440187228,
      "model/head/grad_frac": 0.08180984854698181,
      "model/head/grad_norm": 0.041114263236522675,
      "model/head/grad_zero_frac": 0.00018243126396555454,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7001163983585859,
      "model/head/update_ratio": 0.0006999559118412435,
      "model/head/weight_delta": 9.942093849182129,
      "model/head/weight_delta_rel": 0.1744137704372406,
      "model/head/weight_norm": 58.73836135864258,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42278170585632324,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42272075367393996,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226591885089874,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29049765949878004,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11308315396308899,
      "model/modality_embedder.encoders.pose/grad_norm": 0.056830938905477524,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5296410379955947,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0018350607715547085,
      "model/modality_embedder.encoders.pose/weight_delta": 3.146658420562744,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10281113535165787,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969512939453125,
      "model/modality_embedder/grad_frac": 0.11308315396308899,
      "model/modality_embedder/grad_norm": 0.056830938905477524,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5296410379955947,
      "model/modality_embedder/update_ratio": 0.0018350607715547085,
      "model/modality_embedder/weight_delta": 3.146658420562744,
      "model/modality_embedder/weight_delta_rel": 0.10281113535165787,
      "model/modality_embedder/weight_norm": 30.969512939453125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.7869644165039,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.627472643097644,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.979281425476074,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.611439128515716,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05628826469182968,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.028288165107369423,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010118890786543489,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.719219446182251,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09908999502658844,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95579719543457,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 94.2948989868164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.619726531184863,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.23017406463623,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.293325290036513,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05189675837755203,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.026081174612045288,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008763084770180285,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4480059146881104,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11944162100553513,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.762550354003906,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 96.31888580322266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.404506373256375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.078185081481934,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.519842706880198,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.04956763982772827,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02491065487265587,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008105410379357636,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.734069585800171,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12538306415081024,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.733366012573242,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.92115020751953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 30.010276374859707,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.459756851196289,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.62334288543762,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0476214662194252,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02393258735537529,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007991220336407423,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2077720165252686,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10962642729282379,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.94860076904297,
      "model/normalizer/grad_frac": 0.19601820409297943,
      "model/normalizer/grad_norm": 0.09851067513227463,
      "model/normalizer/grad_zero_frac": 0.00018198772158939391,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0012525416677817702,
      "model/normalizer/weight_delta": 6.750144958496094,
      "model/normalizer/weight_delta_rel": 0.08693795651197433,
      "model/normalizer/weight_norm": 78.64862060546875,
      "pose_mae_dtheta": 0.055059950798749924,
      "pose_mae_dx": 0.013741535134613514,
      "pose_mae_dy": 0.0044470070861279964,
      "pose_rmse_dtheta": 0.24600160121917725,
      "pose_rmse_dx": 0.054810818284749985,
      "pose_rmse_dy": 0.01749212108552456,
      "pose_rmse_mean": 0.10610151290893555,
      "rmse_dtheta": 0.0278105940669775,
      "rmse_dx": 0.006098951678723097,
      "rmse_dy": 0.003003915539011359,
      "rmse_mean": 0.012304486706852913,
      "rotation_flip": 0.001949317753314972,
      "sparse_tokens": 32137.0,
      "step": 9900,
      "turn_loss": 0.04811670631170273,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.4599981416093663,
      "grad_norm": 0.9185718894004822,
      "learning_rate": 7.513728502524286e-07,
      "loss": 0.227,
      "mae_dtheta": 0.0367543026804924,
      "mae_dx": 0.013670168817043304,
      "mae_dy": 0.0030712636653333902,
      "pose_mae_dtheta": 0.3097626864910126,
      "pose_mae_dx": 0.10060743242502213,
      "pose_mae_dy": 0.04129621013998985,
      "pose_rmse_dtheta": 0.5679206848144531,
      "pose_rmse_dx": 0.24849899113178253,
      "pose_rmse_dy": 0.11842649430036545,
      "pose_rmse_mean": 0.3116154074668884,
      "rmse_dtheta": 0.05737258866429329,
      "rmse_dx": 0.02793850377202034,
      "rmse_dy": 0.007098957430571318,
      "rmse_mean": 0.03080335073173046,
      "rotation_flip": 0.0029296875,
      "sparse_tokens": 19542.0,
      "step": 9901,
      "turn_loss": 0.24301081895828247,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4600446013752091,
      "grad_norm": 0.4853634536266327,
      "learning_rate": 7.506758912156864e-07,
      "loss": 0.0762,
      "mae_dtheta": 0.004446644801646471,
      "mae_dx": 0.000993386609479785,
      "mae_dy": 0.0009273962350562215,
      "pose_mae_dtheta": 0.03356245532631874,
      "pose_mae_dx": 0.009858830831944942,
      "pose_mae_dy": 0.014080108143389225,
      "pose_rmse_dtheta": 0.10449539124965668,
      "pose_rmse_dx": 0.03295491635799408,
      "pose_rmse_dy": 0.03441594913601875,
      "pose_rmse_mean": 0.057288751006126404,
      "rmse_dtheta": 0.013401147909462452,
      "rmse_dx": 0.004092843737453222,
      "rmse_dy": 0.0021418165415525436,
      "rmse_mean": 0.006545269396156073,
      "rotation_flip": 0.0019543974194675684,
      "sparse_tokens": 32057.0,
      "step": 9902,
      "turn_loss": 0.03642838075757027,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13928.0,
      "epoch": 0.46009106114105186,
      "grad_norm": 0.4350629448890686,
      "learning_rate": 7.49979229336461e-07,
      "loss": 0.0884,
      "mae_dtheta": 0.030544620007276535,
      "mae_dx": 0.004122571554034948,
      "mae_dy": 0.0058125704526901245,
      "pose_mae_dtheta": 0.22206643223762512,
      "pose_mae_dx": 0.04165602847933769,
      "pose_mae_dy": 0.07975304871797562,
      "pose_rmse_dtheta": 0.44121283292770386,
      "pose_rmse_dx": 0.10347896069288254,
      "pose_rmse_dy": 0.1740022599697113,
      "pose_rmse_mean": 0.2395647019147873,
      "rmse_dtheta": 0.04906358942389488,
      "rmse_dx": 0.011172798462212086,
      "rmse_dy": 0.012509391643106937,
      "rmse_mean": 0.02424859255552292,
      "rotation_flip": 0.008941877633333206,
      "sparse_tokens": 11688.0,
      "step": 9903,
      "turn_loss": 0.17718884348869324,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.46013752090689464,
      "grad_norm": 0.3233134150505066,
      "learning_rate": 7.492828646634675e-07,
      "loss": 0.0547,
      "mae_dtheta": 0.006125146988779306,
      "mae_dx": 0.001180890016257763,
      "mae_dy": 0.0008747476385906339,
      "pose_mae_dtheta": 0.043527018278837204,
      "pose_mae_dx": 0.00952883716672659,
      "pose_mae_dy": 0.010251548141241074,
      "pose_rmse_dtheta": 0.16931140422821045,
      "pose_rmse_dx": 0.02281779609620571,
      "pose_rmse_dy": 0.02682446874678135,
      "pose_rmse_mean": 0.07298456132411957,
      "rmse_dtheta": 0.020424386486411095,
      "rmse_dx": 0.00356098054908216,
      "rmse_dy": 0.0030134518165141344,
      "rmse_mean": 0.008999606594443321,
      "rotation_flip": 0.001818181830458343,
      "sparse_tokens": 32169.0,
      "step": 9904,
      "turn_loss": 0.035776857286691666,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4601839806727374,
      "grad_norm": 0.5081090927124023,
      "learning_rate": 7.485867972454053e-07,
      "loss": 0.1048,
      "mae_dtheta": 0.010131602175533772,
      "mae_dx": 0.0014403625391423702,
      "mae_dy": 0.002338457154110074,
      "pose_mae_dtheta": 0.06652705371379852,
      "pose_mae_dx": 0.019639773294329643,
      "pose_mae_dy": 0.028159981593489647,
      "pose_rmse_dtheta": 0.1459236592054367,
      "pose_rmse_dx": 0.054531678557395935,
      "pose_rmse_dy": 0.06804412603378296,
      "pose_rmse_mean": 0.0894998237490654,
      "rmse_dtheta": 0.021550606936216354,
      "rmse_dx": 0.004575544502586126,
      "rmse_dy": 0.005359146278351545,
      "rmse_mean": 0.010495099239051342,
      "rotation_flip": 0.004581424407660961,
      "sparse_tokens": 32073.0,
      "step": 9905,
      "turn_loss": 0.0863710269331932,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4602304404385802,
      "grad_norm": 0.4672892689704895,
      "learning_rate": 7.478910271309509e-07,
      "loss": 0.0918,
      "mae_dtheta": 0.0056320601142942905,
      "mae_dx": 0.0011255595600232482,
      "mae_dy": 0.0001891322754090652,
      "pose_mae_dtheta": 0.04199640080332756,
      "pose_mae_dx": 0.008347748778760433,
      "pose_mae_dy": 0.002670082962140441,
      "pose_rmse_dtheta": 0.1961633265018463,
      "pose_rmse_dx": 0.020751887932419777,
      "pose_rmse_dy": 0.006529669743031263,
      "pose_rmse_mean": 0.07448163628578186,
      "rmse_dtheta": 0.023717015981674194,
      "rmse_dx": 0.0032069215085357428,
      "rmse_dy": 0.00037138728657737374,
      "rmse_mean": 0.009098442271351814,
      "rotation_flip": 0.0012978585436940193,
      "sparse_tokens": 32201.0,
      "step": 9906,
      "turn_loss": 0.035087332129478455,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.46027690020442297,
      "grad_norm": 0.48574909567832947,
      "learning_rate": 7.471955543687586e-07,
      "loss": 0.0646,
      "mae_dtheta": 0.03577675670385361,
      "mae_dx": 0.008680037222802639,
      "mae_dy": 0.004816942848265171,
      "pose_mae_dtheta": 0.2646046280860901,
      "pose_mae_dx": 0.06667215377092361,
      "pose_mae_dy": 0.07192688435316086,
      "pose_rmse_dtheta": 0.5568474531173706,
      "pose_rmse_dx": 0.18855223059654236,
      "pose_rmse_dy": 0.15979427099227905,
      "pose_rmse_mean": 0.3017313480377197,
      "rmse_dtheta": 0.05847938358783722,
      "rmse_dx": 0.02145996131002903,
      "rmse_dy": 0.008638340048491955,
      "rmse_mean": 0.029525894671678543,
      "rotation_flip": 0.010948904789984226,
      "sparse_tokens": 5123.0,
      "step": 9907,
      "turn_loss": 0.2117573618888855,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.46032335997026574,
      "grad_norm": 0.48438015580177307,
      "learning_rate": 7.465003790074649e-07,
      "loss": 0.1097,
      "mae_dtheta": 0.007919715717434883,
      "mae_dx": 0.0017950686160475016,
      "mae_dy": 0.0022017834708094597,
      "pose_mae_dtheta": 0.05733116716146469,
      "pose_mae_dx": 0.019696271046996117,
      "pose_mae_dy": 0.01649933122098446,
      "pose_rmse_dtheta": 0.2079254686832428,
      "pose_rmse_dx": 0.050898317247629166,
      "pose_rmse_dy": 0.04194370284676552,
      "pose_rmse_mean": 0.10025583207607269,
      "rmse_dtheta": 0.02378961630165577,
      "rmse_dx": 0.004185791593044996,
      "rmse_dy": 0.005250491201877594,
      "rmse_mean": 0.011075301095843315,
      "rotation_flip": 0.004729148931801319,
      "sparse_tokens": 32169.0,
      "step": 9908,
      "turn_loss": 0.0673997551202774,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4603698197361085,
      "grad_norm": 0.4564463198184967,
      "learning_rate": 7.45805501095681e-07,
      "loss": 0.1013,
      "mae_dtheta": 0.008296629413962364,
      "mae_dx": 0.0013459005858749151,
      "mae_dy": 0.0012011176440864801,
      "pose_mae_dtheta": 0.05746418610215187,
      "pose_mae_dx": 0.014002049341797829,
      "pose_mae_dy": 0.01605251431465149,
      "pose_rmse_dtheta": 0.168851837515831,
      "pose_rmse_dx": 0.040859073400497437,
      "pose_rmse_dy": 0.04054202139377594,
      "pose_rmse_mean": 0.08341764658689499,
      "rmse_dtheta": 0.02180110290646553,
      "rmse_dx": 0.004858967382460833,
      "rmse_dy": 0.0027356038335710764,
      "rmse_mean": 0.009798558428883553,
      "rotation_flip": 0.0036479707341641188,
      "sparse_tokens": 32137.0,
      "step": 9909,
      "turn_loss": 0.05559428408741951,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4604162795019513,
      "grad_norm": 0.5387054085731506,
      "learning_rate": 7.451109206820034e-07,
      "loss": 0.1245,
      "mae_dtheta": 0.011588056571781635,
      "mae_dx": 0.0016383164329454303,
      "mae_dy": 0.0029691404197365046,
      "pose_mae_dtheta": 0.07499322295188904,
      "pose_mae_dx": 0.025616399943828583,
      "pose_mae_dy": 0.031614407896995544,
      "pose_rmse_dtheta": 0.1595345139503479,
      "pose_rmse_dx": 0.05765116587281227,
      "pose_rmse_dy": 0.06721378862857819,
      "pose_rmse_mean": 0.09479981660842896,
      "rmse_dtheta": 0.022761691361665726,
      "rmse_dx": 0.004343945533037186,
      "rmse_dy": 0.00578701589256525,
      "rmse_mean": 0.010964217595756054,
      "rotation_flip": 0.01272845920175314,
      "sparse_tokens": 32105.0,
      "step": 9910,
      "turn_loss": 0.09551497548818588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25313.0,
      "epoch": 0.4604627392677941,
      "grad_norm": 0.8161922097206116,
      "learning_rate": 7.444166378150014e-07,
      "loss": 0.2466,
      "mae_dtheta": 0.023589542135596275,
      "mae_dx": 0.013093150220811367,
      "mae_dy": 0.004165512043982744,
      "pose_mae_dtheta": 0.1722317487001419,
      "pose_mae_dx": 0.10527796298265457,
      "pose_mae_dy": 0.05596960335969925,
      "pose_rmse_dtheta": 0.3477647304534912,
      "pose_rmse_dx": 0.24979038536548615,
      "pose_rmse_dy": 0.1628662347793579,
      "pose_rmse_mean": 0.25347378849983215,
      "rmse_dtheta": 0.041846707463264465,
      "rmse_dx": 0.026466073468327522,
      "rmse_dy": 0.010463503189384937,
      "rmse_mean": 0.026258762925863266,
      "rotation_flip": 0.01522359624505043,
      "sparse_tokens": 21191.0,
      "step": 9911,
      "turn_loss": 0.2237178087234497,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.46050919903363685,
      "grad_norm": 0.4286857843399048,
      "learning_rate": 7.437226525432284e-07,
      "loss": 0.0755,
      "mae_dtheta": 0.04259385168552399,
      "mae_dx": 0.012196642346680164,
      "mae_dy": 0.004832539241760969,
      "pose_mae_dtheta": 0.3903758227825165,
      "pose_mae_dx": 0.09901063144207001,
      "pose_mae_dy": 0.0486338846385479,
      "pose_rmse_dtheta": 0.6693777441978455,
      "pose_rmse_dx": 0.2341216653585434,
      "pose_rmse_dy": 0.12023307383060455,
      "pose_rmse_mean": 0.3412441909313202,
      "rmse_dtheta": 0.06529007107019424,
      "rmse_dx": 0.024857893586158752,
      "rmse_dy": 0.010318358428776264,
      "rmse_mean": 0.03348877653479576,
      "rotation_flip": 0.014332965947687626,
      "sparse_tokens": 14819.0,
      "step": 9912,
      "turn_loss": 0.27746066451072693,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.46055565879947963,
      "grad_norm": 0.5785410404205322,
      "learning_rate": 7.430289649152156e-07,
      "loss": 0.1119,
      "mae_dtheta": 0.010505433194339275,
      "mae_dx": 0.0013878578320145607,
      "mae_dy": 0.002532422775402665,
      "pose_mae_dtheta": 0.06506368517875671,
      "pose_mae_dx": 0.022935429587960243,
      "pose_mae_dy": 0.028982654213905334,
      "pose_rmse_dtheta": 0.14437435567378998,
      "pose_rmse_dx": 0.05496419966220856,
      "pose_rmse_dy": 0.05904027447104454,
      "pose_rmse_mean": 0.08612628281116486,
      "rmse_dtheta": 0.021612195298075676,
      "rmse_dx": 0.00413909088820219,
      "rmse_dy": 0.0049127149395644665,
      "rmse_mean": 0.010221334174275398,
      "rotation_flip": 0.0018804061692208052,
      "sparse_tokens": 32041.0,
      "step": 9913,
      "turn_loss": 0.08692371845245361,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.4606021185653224,
      "grad_norm": 0.743385374546051,
      "learning_rate": 7.423355749794714e-07,
      "loss": 0.1742,
      "mae_dtheta": 0.02978440374135971,
      "mae_dx": 0.005531996488571167,
      "mae_dy": 0.003115531522780657,
      "pose_mae_dtheta": 0.24805665016174316,
      "pose_mae_dx": 0.04086931794881821,
      "pose_mae_dy": 0.054979827255010605,
      "pose_rmse_dtheta": 0.5266547203063965,
      "pose_rmse_dx": 0.1164979636669159,
      "pose_rmse_dy": 0.1376233696937561,
      "pose_rmse_mean": 0.2602587044239044,
      "rmse_dtheta": 0.05364488810300827,
      "rmse_dx": 0.016952617093920708,
      "rmse_dy": 0.006701501086354256,
      "rmse_mean": 0.025766335427761078,
      "rotation_flip": 0.015306122601032257,
      "sparse_tokens": 3364.0,
      "step": 9914,
      "turn_loss": 0.12855340540409088,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.46064857833116524,
      "grad_norm": 0.5476304888725281,
      "learning_rate": 7.416424827844865e-07,
      "loss": 0.1467,
      "mae_dtheta": 0.009335857816040516,
      "mae_dx": 0.0018926222110167146,
      "mae_dy": 0.0023940452374517918,
      "pose_mae_dtheta": 0.06202609837055206,
      "pose_mae_dx": 0.02112700045108795,
      "pose_mae_dy": 0.024090450257062912,
      "pose_rmse_dtheta": 0.16367848217487335,
      "pose_rmse_dx": 0.05523000285029411,
      "pose_rmse_dy": 0.05367758125066757,
      "pose_rmse_mean": 0.09086202830076218,
      "rmse_dtheta": 0.020782366394996643,
      "rmse_dx": 0.0053320531733334064,
      "rmse_dy": 0.005235342308878899,
      "rmse_mean": 0.01044992171227932,
      "rotation_flip": 0.00233281496912241,
      "sparse_tokens": 32073.0,
      "step": 9915,
      "turn_loss": 0.09673553705215454,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.460695038097008,
      "grad_norm": 0.5151516795158386,
      "learning_rate": 7.409496883787276e-07,
      "loss": 0.1196,
      "mae_dtheta": 0.024536632001399994,
      "mae_dx": 0.0015364745631814003,
      "mae_dy": 0.003609119448810816,
      "pose_mae_dtheta": 0.17995111644268036,
      "pose_mae_dx": 0.030503613874316216,
      "pose_mae_dy": 0.061007868498563766,
      "pose_rmse_dtheta": 0.39149579405784607,
      "pose_rmse_dx": 0.10039103776216507,
      "pose_rmse_dy": 0.1689751148223877,
      "pose_rmse_mean": 0.22028732299804688,
      "rmse_dtheta": 0.05034066364169121,
      "rmse_dx": 0.004108697175979614,
      "rmse_dy": 0.009105983190238476,
      "rmse_mean": 0.021185114979743958,
      "rotation_flip": 0.013333333656191826,
      "sparse_tokens": 4312.0,
      "step": 9916,
      "turn_loss": 0.15196573734283447,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.4607414978628508,
      "grad_norm": 0.6305846571922302,
      "learning_rate": 7.402571918106427e-07,
      "loss": 0.1391,
      "mae_dtheta": 0.034655503928661346,
      "mae_dx": 0.012539510615170002,
      "mae_dy": 0.0059647755697369576,
      "pose_mae_dtheta": 0.23492580652236938,
      "pose_mae_dx": 0.0983109176158905,
      "pose_mae_dy": 0.07412873953580856,
      "pose_rmse_dtheta": 0.4267452359199524,
      "pose_rmse_dx": 0.20199216902256012,
      "pose_rmse_dy": 0.15376654267311096,
      "pose_rmse_mean": 0.260834664106369,
      "rmse_dtheta": 0.05138087272644043,
      "rmse_dx": 0.024902915582060814,
      "rmse_dy": 0.01023106463253498,
      "rmse_mean": 0.02883828431367874,
      "rotation_flip": 0.015432098880410194,
      "sparse_tokens": 4884.0,
      "step": 9917,
      "turn_loss": 0.26792973279953003,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.46078795762869357,
      "grad_norm": 0.6696555018424988,
      "learning_rate": 7.395649931286597e-07,
      "loss": 0.1424,
      "mae_dtheta": 0.0073416586965322495,
      "mae_dx": 0.0016416573198512197,
      "mae_dy": 0.0020247292704880238,
      "pose_mae_dtheta": 0.05139778554439545,
      "pose_mae_dx": 0.021628810092806816,
      "pose_mae_dy": 0.019909322261810303,
      "pose_rmse_dtheta": 0.15566003322601318,
      "pose_rmse_dx": 0.08899589627981186,
      "pose_rmse_dy": 0.05492585524916649,
      "pose_rmse_mean": 0.09986060112714767,
      "rmse_dtheta": 0.019264400005340576,
      "rmse_dx": 0.006521735806018114,
      "rmse_dy": 0.005993618164211512,
      "rmse_mean": 0.010593252256512642,
      "rotation_flip": 0.00334075721912086,
      "sparse_tokens": 32041.0,
      "step": 9918,
      "turn_loss": 0.06629612296819687,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.46083441739453634,
      "grad_norm": 0.36736851930618286,
      "learning_rate": 7.388730923811827e-07,
      "loss": 0.0747,
      "mae_dtheta": 0.008017566986382008,
      "mae_dx": 0.0011564702726900578,
      "mae_dy": 0.001752253039740026,
      "pose_mae_dtheta": 0.04996752366423607,
      "pose_mae_dx": 0.01458770502358675,
      "pose_mae_dy": 0.018710743635892868,
      "pose_rmse_dtheta": 0.14399027824401855,
      "pose_rmse_dx": 0.04194093868136406,
      "pose_rmse_dy": 0.04614534229040146,
      "pose_rmse_mean": 0.07735885679721832,
      "rmse_dtheta": 0.01928829774260521,
      "rmse_dx": 0.00398618308827281,
      "rmse_dy": 0.004739107098430395,
      "rmse_mean": 0.009337862953543663,
      "rotation_flip": 0.0037878789007663727,
      "sparse_tokens": 32057.0,
      "step": 9919,
      "turn_loss": 0.060136958956718445,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4608808771603791,
      "grad_norm": 0.36156222224235535,
      "learning_rate": 7.381814896165979e-07,
      "loss": 0.1005,
      "mae_dtheta": 0.005292927846312523,
      "mae_dx": 0.0007915559108369052,
      "mae_dy": 0.000771385442931205,
      "pose_mae_dtheta": 0.03269432112574577,
      "pose_mae_dx": 0.008121426217257977,
      "pose_mae_dy": 0.011917905882000923,
      "pose_rmse_dtheta": 0.11250071227550507,
      "pose_rmse_dx": 0.021387659013271332,
      "pose_rmse_dy": 0.03151671960949898,
      "pose_rmse_mean": 0.05513502657413483,
      "rmse_dtheta": 0.01670122519135475,
      "rmse_dx": 0.0025524517986923456,
      "rmse_dy": 0.0017168044578284025,
      "rmse_mean": 0.0069901603274047375,
      "rotation_flip": 0.001398601452820003,
      "sparse_tokens": 32137.0,
      "step": 9920,
      "turn_loss": 0.029573233798146248,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4609273369262219,
      "grad_norm": 0.6370506882667542,
      "learning_rate": 7.374901848832683e-07,
      "loss": 0.1158,
      "mae_dtheta": 0.013032224029302597,
      "mae_dx": 0.002758174203336239,
      "mae_dy": 0.0028870825190097094,
      "pose_mae_dtheta": 0.09458614140748978,
      "pose_mae_dx": 0.03217142075300217,
      "pose_mae_dy": 0.03524636849761009,
      "pose_rmse_dtheta": 0.2681947350502014,
      "pose_rmse_dx": 0.10678143054246902,
      "pose_rmse_dy": 0.11285705119371414,
      "pose_rmse_mean": 0.16261106729507446,
      "rmse_dtheta": 0.030226461589336395,
      "rmse_dx": 0.009132001549005508,
      "rmse_dy": 0.008938297629356384,
      "rmse_mean": 0.01609892025589943,
      "rotation_flip": 0.0060728746466338634,
      "sparse_tokens": 32073.0,
      "step": 9921,
      "turn_loss": 0.1076028048992157,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4609737966920647,
      "grad_norm": 0.3649485111236572,
      "learning_rate": 7.367991782295392e-07,
      "loss": 0.0648,
      "mae_dtheta": 0.007849251851439476,
      "mae_dx": 0.0013712558429688215,
      "mae_dy": 0.0009442691807635128,
      "pose_mae_dtheta": 0.05595870316028595,
      "pose_mae_dx": 0.01258019171655178,
      "pose_mae_dy": 0.012895357795059681,
      "pose_rmse_dtheta": 0.2157532125711441,
      "pose_rmse_dx": 0.0357220359146595,
      "pose_rmse_dy": 0.047548726201057434,
      "pose_rmse_mean": 0.09967466443777084,
      "rmse_dtheta": 0.024314161390066147,
      "rmse_dx": 0.004402092192322016,
      "rmse_dy": 0.0028124304953962564,
      "rmse_mean": 0.010509561747312546,
      "rotation_flip": 0.002627430483698845,
      "sparse_tokens": 32153.0,
      "step": 9922,
      "turn_loss": 0.05741071328520775,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.46102025645790745,
      "grad_norm": 0.40565577149391174,
      "learning_rate": 7.361084697037307e-07,
      "loss": 0.1051,
      "mae_dtheta": 0.009029345586895943,
      "mae_dx": 0.0021630204282701015,
      "mae_dy": 0.001864783582277596,
      "pose_mae_dtheta": 0.06058060750365257,
      "pose_mae_dx": 0.01953497715294361,
      "pose_mae_dy": 0.019108325242996216,
      "pose_rmse_dtheta": 0.16344188153743744,
      "pose_rmse_dx": 0.05285785347223282,
      "pose_rmse_dy": 0.0478242002427578,
      "pose_rmse_mean": 0.08804132044315338,
      "rmse_dtheta": 0.021963762119412422,
      "rmse_dx": 0.006525238510221243,
      "rmse_dy": 0.004931929986923933,
      "rmse_mean": 0.011140311136841774,
      "rotation_flip": 0.006049149204045534,
      "sparse_tokens": 32137.0,
      "step": 9923,
      "turn_loss": 0.09153257310390472,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.46106671622375023,
      "grad_norm": 0.6179155111312866,
      "learning_rate": 7.35418059354146e-07,
      "loss": 0.1332,
      "mae_dtheta": 0.037165433168411255,
      "mae_dx": 0.011327531188726425,
      "mae_dy": 0.0055367774330079556,
      "pose_mae_dtheta": 0.26833587884902954,
      "pose_mae_dx": 0.10786169022321701,
      "pose_mae_dy": 0.08615747094154358,
      "pose_rmse_dtheta": 0.45092716813087463,
      "pose_rmse_dx": 0.24102425575256348,
      "pose_rmse_dy": 0.16198161244392395,
      "pose_rmse_mean": 0.28464433550834656,
      "rmse_dtheta": 0.053722649812698364,
      "rmse_dx": 0.02449779212474823,
      "rmse_dy": 0.009473289363086224,
      "rmse_mean": 0.029231242835521698,
      "rotation_flip": 0.009404388256371021,
      "sparse_tokens": 5109.0,
      "step": 9924,
      "turn_loss": 0.30102095007896423,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.461113175989593,
      "grad_norm": 0.3880902826786041,
      "learning_rate": 7.347279472290647e-07,
      "loss": 0.0886,
      "mae_dtheta": 0.00899372436106205,
      "mae_dx": 0.0014744214713573456,
      "mae_dy": 0.0018154472345486283,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3880902826786041,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.1870574951172,
      "model/head/act_norm_mean": 116.759765625,
      "model/head/act_norm_min": 57.97880935668945,
      "model/head/act_over_embed": 80.2384040596482,
      "model/head/grad_frac": 0.11987383663654327,
      "model/head/grad_norm": 0.0465218722820282,
      "model/head/grad_zero_frac": 0.00019639122183434665,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7023605192550505,
      "model/head/update_ratio": 0.0007920172065496445,
      "model/head/weight_delta": 9.943552017211914,
      "model/head/weight_delta_rel": 0.17443935573101044,
      "model/head/weight_norm": 58.738460540771484,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228077828884125,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42273483612463864,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226660430431366,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29050733709074217,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09598267823457718,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03724994510412216,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5444228386563876,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001202794024720788,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1468710899353027,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1028180867433548,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969512939453125,
      "model/modality_embedder/grad_frac": 0.09598267823457718,
      "model/modality_embedder/grad_norm": 0.03724994510412216,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5444228386563876,
      "model/modality_embedder/update_ratio": 0.001202794024720788,
      "model/modality_embedder/weight_delta": 3.1468710899353027,
      "model/modality_embedder/weight_delta_rel": 0.1028180867433548,
      "model/modality_embedder/weight_norm": 30.969512939453125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.38684844970703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.322904140612472,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.159274101257324,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.71492744004516,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0747498944401741,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.029009707272052765,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001037693815305829,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.719893217086792,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0991145521402359,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95594024658203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.88359832763672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.320629409171076,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.138333320617676,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.400573585449763,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07997241616249084,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03103651851415634,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001042795367538929,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.448867082595825,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11947145313024521,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76280975341797,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.65074920654297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.142907247073914,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.007149696350098,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.652859976090504,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.079873226583004,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.030998023226857185,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010086029069498181,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.735034942626953,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12541547417640686,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.733625411987305,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.67170715332031,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.827095358345357,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.60146713256836,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.81024981377376,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07643558084964752,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02966390550136566,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009904829785227776,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.208766460418701,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10966040939092636,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.948930740356445,
      "model/normalizer/grad_frac": 0.2933162450790405,
      "model/normalizer/grad_norm": 0.11383318901062012,
      "model/normalizer/grad_zero_frac": 0.00019144162070006132,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014473588671535254,
      "model/normalizer/weight_delta": 6.751950740814209,
      "model/normalizer/weight_delta_rel": 0.08696121722459793,
      "model/normalizer/weight_norm": 78.6489028930664,
      "pose_mae_dtheta": 0.05598750337958336,
      "pose_mae_dx": 0.015056821517646313,
      "pose_mae_dy": 0.014068028889596462,
      "pose_rmse_dtheta": 0.19657275080680847,
      "pose_rmse_dx": 0.05818586423993111,
      "pose_rmse_dy": 0.031120464205741882,
      "pose_rmse_mean": 0.09529303014278412,
      "rmse_dtheta": 0.023922910913825035,
      "rmse_dx": 0.005719066131860018,
      "rmse_dy": 0.005740826018154621,
      "rmse_mean": 0.011794268153607845,
      "rotation_flip": 0.003805174957960844,
      "sparse_tokens": 32137.0,
      "step": 9925,
      "turn_loss": 0.06831010431051254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.4611596357554358,
      "grad_norm": 0.6841849684715271,
      "learning_rate": 7.340381333767487e-07,
      "loss": 0.1531,
      "mae_dtheta": 0.03969501331448555,
      "mae_dx": 0.010501758195459843,
      "mae_dy": 0.007544151972979307,
      "pose_mae_dtheta": 0.3171364367008209,
      "pose_mae_dx": 0.09645791351795197,
      "pose_mae_dy": 0.10691019147634506,
      "pose_rmse_dtheta": 0.5291206240653992,
      "pose_rmse_dx": 0.20322608947753906,
      "pose_rmse_dy": 0.2209881991147995,
      "pose_rmse_mean": 0.3177783191204071,
      "rmse_dtheta": 0.05816688761115074,
      "rmse_dx": 0.02262311801314354,
      "rmse_dy": 0.013544752262532711,
      "rmse_mean": 0.03144492208957672,
      "rotation_flip": 0.016339870169758797,
      "sparse_tokens": 22226.0,
      "step": 9926,
      "turn_loss": 0.27036821842193604,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.46120609552127856,
      "grad_norm": 0.5043995976448059,
      "learning_rate": 7.333486178454341e-07,
      "loss": 0.0939,
      "mae_dtheta": 0.00793469324707985,
      "mae_dx": 0.0022765134926885366,
      "mae_dy": 0.0023767256643623114,
      "pose_mae_dtheta": 0.055352695286273956,
      "pose_mae_dx": 0.02363540418446064,
      "pose_mae_dy": 0.01958318054676056,
      "pose_rmse_dtheta": 0.19090107083320618,
      "pose_rmse_dx": 0.07491349428892136,
      "pose_rmse_dy": 0.05038600042462349,
      "pose_rmse_mean": 0.1054001972079277,
      "rmse_dtheta": 0.022790851071476936,
      "rmse_dx": 0.0070645445957779884,
      "rmse_dy": 0.006169362924993038,
      "rmse_mean": 0.01200825348496437,
      "rotation_flip": 0.0030651341658085585,
      "sparse_tokens": 32169.0,
      "step": 9927,
      "turn_loss": 0.07914938777685165,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.46125255528712134,
      "grad_norm": 0.5249056220054626,
      "learning_rate": 7.32659400683342e-07,
      "loss": 0.1383,
      "mae_dtheta": 0.030147269368171692,
      "mae_dx": 0.010900305584073067,
      "mae_dy": 0.007804660126566887,
      "pose_mae_dtheta": 0.24302248656749725,
      "pose_mae_dx": 0.07802879810333252,
      "pose_mae_dy": 0.07561206072568893,
      "pose_rmse_dtheta": 0.43751055002212524,
      "pose_rmse_dx": 0.18079258501529694,
      "pose_rmse_dy": 0.19139201939105988,
      "pose_rmse_mean": 0.269898384809494,
      "rmse_dtheta": 0.04774460569024086,
      "rmse_dx": 0.022092359140515327,
      "rmse_dy": 0.016710514202713966,
      "rmse_mean": 0.0288491602987051,
      "rotation_flip": 0.01541425846517086,
      "sparse_tokens": 19884.0,
      "step": 9928,
      "turn_loss": 0.27268001437187195,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4612990150529641,
      "grad_norm": 0.5356787443161011,
      "learning_rate": 7.319704819386675e-07,
      "loss": 0.0723,
      "mae_dtheta": 0.00636985432356596,
      "mae_dx": 0.0014365680981427431,
      "mae_dy": 0.0012457511620596051,
      "pose_mae_dtheta": 0.041465483605861664,
      "pose_mae_dx": 0.013673926703631878,
      "pose_mae_dy": 0.01672075130045414,
      "pose_rmse_dtheta": 0.11097623407840729,
      "pose_rmse_dx": 0.04001694172620773,
      "pose_rmse_dy": 0.03890382871031761,
      "pose_rmse_mean": 0.06329900026321411,
      "rmse_dtheta": 0.017035627737641335,
      "rmse_dx": 0.005050593055784702,
      "rmse_dy": 0.0029263829346746206,
      "rmse_mean": 0.008337534964084625,
      "rotation_flip": 0.0023108029272407293,
      "sparse_tokens": 32089.0,
      "step": 9929,
      "turn_loss": 0.05209869146347046,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1980.0,
      "epoch": 0.4613454748188069,
      "grad_norm": 0.6023610234260559,
      "learning_rate": 7.31281861659589e-07,
      "loss": 0.1261,
      "mae_dtheta": 0.03695497289299965,
      "mae_dx": 0.0036136568523943424,
      "mae_dy": 0.0007072277367115021,
      "pose_mae_dtheta": 0.32560572028160095,
      "pose_mae_dx": 0.013508433476090431,
      "pose_mae_dy": 0.007798090111464262,
      "pose_rmse_dtheta": 0.7229298949241638,
      "pose_rmse_dx": 0.03262275829911232,
      "pose_rmse_dy": 0.018909674137830734,
      "pose_rmse_mean": 0.25815412402153015,
      "rmse_dtheta": 0.06580353528261185,
      "rmse_dx": 0.009340432472527027,
      "rmse_dy": 0.0012407777830958366,
      "rmse_mean": 0.025461582466959953,
      "rotation_flip": 0.014705882407724857,
      "sparse_tokens": 1700.0,
      "step": 9930,
      "turn_loss": 0.11733570694923401,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4613919345846497,
      "grad_norm": 0.6012605428695679,
      "learning_rate": 7.305935398942598e-07,
      "loss": 0.196,
      "mae_dtheta": 0.014181720092892647,
      "mae_dx": 0.0017831807490438223,
      "mae_dy": 0.0029666568152606487,
      "pose_mae_dtheta": 0.09956535696983337,
      "pose_mae_dx": 0.02179090492427349,
      "pose_mae_dy": 0.03126677870750427,
      "pose_rmse_dtheta": 0.2578057050704956,
      "pose_rmse_dx": 0.057987067848443985,
      "pose_rmse_dy": 0.07285993546247482,
      "pose_rmse_mean": 0.12955090403556824,
      "rmse_dtheta": 0.030014289543032646,
      "rmse_dx": 0.0055572292767465115,
      "rmse_dy": 0.007295575458556414,
      "rmse_mean": 0.014289031736552715,
      "rotation_flip": 0.00498545914888382,
      "sparse_tokens": 32057.0,
      "step": 9931,
      "turn_loss": 0.11291338503360748,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4614383943504925,
      "grad_norm": 0.39262303709983826,
      "learning_rate": 7.29905516690817e-07,
      "loss": 0.1022,
      "mae_dtheta": 0.008916517719626427,
      "mae_dx": 0.0013088473351672292,
      "mae_dy": 0.0025643818080425262,
      "pose_mae_dtheta": 0.05332216992974281,
      "pose_mae_dx": 0.02089701034128666,
      "pose_mae_dy": 0.02941802889108658,
      "pose_rmse_dtheta": 0.12631715834140778,
      "pose_rmse_dx": 0.04815360903739929,
      "pose_rmse_dy": 0.058022066950798035,
      "pose_rmse_mean": 0.07749761641025543,
      "rmse_dtheta": 0.018103288486599922,
      "rmse_dx": 0.0035423003137111664,
      "rmse_dy": 0.00483411829918623,
      "rmse_mean": 0.008826568722724915,
      "rotation_flip": 0.0031779659911990166,
      "sparse_tokens": 32057.0,
      "step": 9932,
      "turn_loss": 0.07775682210922241,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25235.0,
      "epoch": 0.4614848541163353,
      "grad_norm": 0.8030985593795776,
      "learning_rate": 7.292177920973726e-07,
      "loss": 0.1915,
      "mae_dtheta": 0.035887494683265686,
      "mae_dx": 0.010154405608773232,
      "mae_dy": 0.004553813487291336,
      "pose_mae_dtheta": 0.29513970017433167,
      "pose_mae_dx": 0.07575272768735886,
      "pose_mae_dy": 0.05997377261519432,
      "pose_rmse_dtheta": 0.5512773394584656,
      "pose_rmse_dx": 0.18205799162387848,
      "pose_rmse_dy": 0.15361164510250092,
      "pose_rmse_mean": 0.295648992061615,
      "rmse_dtheta": 0.05666584149003029,
      "rmse_dx": 0.022284870967268944,
      "rmse_dy": 0.009156866930425167,
      "rmse_mean": 0.02936919406056404,
      "rotation_flip": 0.011130137369036674,
      "sparse_tokens": 19260.0,
      "step": 9933,
      "turn_loss": 0.23974892497062683,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.46153131388217805,
      "grad_norm": 0.4038873314857483,
      "learning_rate": 7.285303661620208e-07,
      "loss": 0.1119,
      "mae_dtheta": 0.012203279882669449,
      "mae_dx": 0.0020150644704699516,
      "mae_dy": 0.0034411391243338585,
      "pose_mae_dtheta": 0.07762804627418518,
      "pose_mae_dx": 0.027905885130167007,
      "pose_mae_dy": 0.03770238906145096,
      "pose_rmse_dtheta": 0.1904749572277069,
      "pose_rmse_dx": 0.07153941690921783,
      "pose_rmse_dy": 0.09065162390470505,
      "pose_rmse_mean": 0.11755534261465073,
      "rmse_dtheta": 0.02492571249604225,
      "rmse_dx": 0.007189436350017786,
      "rmse_dy": 0.008027317002415657,
      "rmse_mean": 0.013380823656916618,
      "rotation_flip": 0.010518679395318031,
      "sparse_tokens": 32089.0,
      "step": 9934,
      "turn_loss": 0.11275021731853485,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.46157777364802083,
      "grad_norm": 0.46334320306777954,
      "learning_rate": 7.278432389328327e-07,
      "loss": 0.0994,
      "mae_dtheta": 0.008575324900448322,
      "mae_dx": 0.001674167113378644,
      "mae_dy": 0.0017361351056024432,
      "pose_mae_dtheta": 0.05276103690266609,
      "pose_mae_dx": 0.017812900245189667,
      "pose_mae_dy": 0.021315446123480797,
      "pose_rmse_dtheta": 0.14003796875476837,
      "pose_rmse_dx": 0.054414764046669006,
      "pose_rmse_dy": 0.05565647408366203,
      "pose_rmse_mean": 0.08336973190307617,
      "rmse_dtheta": 0.02133829891681671,
      "rmse_dx": 0.006234786938875914,
      "rmse_dy": 0.004494648426771164,
      "rmse_mean": 0.010689245536923409,
      "rotation_flip": 0.0038151759654283524,
      "sparse_tokens": 32105.0,
      "step": 9935,
      "turn_loss": 0.07837380468845367,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4616242334138636,
      "grad_norm": 0.38536420464515686,
      "learning_rate": 7.271564104578604e-07,
      "loss": 0.0857,
      "mae_dtheta": 0.007197052240371704,
      "mae_dx": 0.002157669747248292,
      "mae_dy": 0.0006106274086050689,
      "pose_mae_dtheta": 0.05599835142493248,
      "pose_mae_dx": 0.01834120973944664,
      "pose_mae_dy": 0.009864993393421173,
      "pose_rmse_dtheta": 0.24294206500053406,
      "pose_rmse_dx": 0.05938879773020744,
      "pose_rmse_dy": 0.038017984479665756,
      "pose_rmse_mean": 0.11344961822032928,
      "rmse_dtheta": 0.026453305035829544,
      "rmse_dx": 0.007325936108827591,
      "rmse_dy": 0.0017593282973393798,
      "rmse_mean": 0.011846190318465233,
      "rotation_flip": 0.0,
      "sparse_tokens": 32137.0,
      "step": 9936,
      "turn_loss": 0.06253614276647568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25878.0,
      "epoch": 0.4616706931797064,
      "grad_norm": 0.4866678714752197,
      "learning_rate": 7.264698807851328e-07,
      "loss": 0.0817,
      "mae_dtheta": 0.026696616783738136,
      "mae_dx": 0.012138397432863712,
      "mae_dy": 0.003441207343712449,
      "pose_mae_dtheta": 0.20644181966781616,
      "pose_mae_dx": 0.10838815569877625,
      "pose_mae_dy": 0.04574945941567421,
      "pose_rmse_dtheta": 0.384513258934021,
      "pose_rmse_dx": 0.2599683403968811,
      "pose_rmse_dy": 0.10145952552556992,
      "pose_rmse_mean": 0.2486470341682434,
      "rmse_dtheta": 0.042311202734708786,
      "rmse_dx": 0.025919653475284576,
      "rmse_dy": 0.006734398193657398,
      "rmse_mean": 0.024988418444991112,
      "rotation_flip": 0.009920635260641575,
      "sparse_tokens": 20735.0,
      "step": 9937,
      "turn_loss": 0.23366770148277283,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 15221.0,
      "epoch": 0.46171715294554916,
      "grad_norm": 0.5152233839035034,
      "learning_rate": 7.257836499626602e-07,
      "loss": 0.1394,
      "mae_dtheta": 0.033901553601026535,
      "mae_dx": 0.013543058186769485,
      "mae_dy": 0.004663161933422089,
      "pose_mae_dtheta": 0.2655010223388672,
      "pose_mae_dx": 0.08859436213970184,
      "pose_mae_dy": 0.05843459814786911,
      "pose_rmse_dtheta": 0.5119513869285583,
      "pose_rmse_dx": 0.2253614366054535,
      "pose_rmse_dy": 0.1713157445192337,
      "pose_rmse_mean": 0.30287617444992065,
      "rmse_dtheta": 0.05294601991772652,
      "rmse_dx": 0.0272829607129097,
      "rmse_dy": 0.01034504547715187,
      "rmse_mean": 0.030191343277692795,
      "rotation_flip": 0.01957831345498562,
      "sparse_tokens": 12411.0,
      "step": 9938,
      "turn_loss": 0.2686084806919098,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.46176361271139194,
      "grad_norm": 0.3290988802909851,
      "learning_rate": 7.250977180384322e-07,
      "loss": 0.0727,
      "mae_dtheta": 0.012456553056836128,
      "mae_dx": 0.001506240339949727,
      "mae_dy": 0.0027653155848383904,
      "pose_mae_dtheta": 0.07515013962984085,
      "pose_mae_dx": 0.025729039683938026,
      "pose_mae_dy": 0.03583313524723053,
      "pose_rmse_dtheta": 0.146933451294899,
      "pose_rmse_dx": 0.06471505016088486,
      "pose_rmse_dy": 0.08354774117469788,
      "pose_rmse_mean": 0.09839874505996704,
      "rmse_dtheta": 0.022225679829716682,
      "rmse_dx": 0.004527430981397629,
      "rmse_dy": 0.005603314843028784,
      "rmse_mean": 0.010785475373268127,
      "rotation_flip": 0.0027434842195361853,
      "sparse_tokens": 32089.0,
      "step": 9939,
      "turn_loss": 0.09970711171627045,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4618100724772347,
      "grad_norm": 0.5191848278045654,
      "learning_rate": 7.244120850604142e-07,
      "loss": 0.0983,
      "mae_dtheta": 0.00908895954489708,
      "mae_dx": 0.001649076584726572,
      "mae_dy": 0.0016202462138608098,
      "pose_mae_dtheta": 0.061174407601356506,
      "pose_mae_dx": 0.02097356878221035,
      "pose_mae_dy": 0.02261422760784626,
      "pose_rmse_dtheta": 0.17567311227321625,
      "pose_rmse_dx": 0.05934390053153038,
      "pose_rmse_dy": 0.06457410007715225,
      "pose_rmse_mean": 0.09986370801925659,
      "rmse_dtheta": 0.022320451214909554,
      "rmse_dx": 0.0056939031928777695,
      "rmse_dy": 0.004136285278946161,
      "rmse_mean": 0.010716880671679974,
      "rotation_flip": 0.0029515938367694616,
      "sparse_tokens": 32073.0,
      "step": 9940,
      "turn_loss": 0.06918782740831375,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.4618565322430775,
      "grad_norm": 0.5467933416366577,
      "learning_rate": 7.237267510765549e-07,
      "loss": 0.1015,
      "mae_dtheta": 0.03674352914094925,
      "mae_dx": 0.013685032725334167,
      "mae_dy": 0.003605386707931757,
      "pose_mae_dtheta": 0.32174286246299744,
      "pose_mae_dx": 0.10648907721042633,
      "pose_mae_dy": 0.03951134532690048,
      "pose_rmse_dtheta": 0.5761364698410034,
      "pose_rmse_dx": 0.24049712717533112,
      "pose_rmse_dy": 0.13186758756637573,
      "pose_rmse_mean": 0.31616705656051636,
      "rmse_dtheta": 0.05745052173733711,
      "rmse_dx": 0.026778198778629303,
      "rmse_dy": 0.010340285487473011,
      "rmse_mean": 0.03152300417423248,
      "rotation_flip": 0.0062500000931322575,
      "sparse_tokens": 8456.0,
      "step": 9941,
      "turn_loss": 0.3093504011631012,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.46190299200892027,
      "grad_norm": 0.3752025067806244,
      "learning_rate": 7.230417161347785e-07,
      "loss": 0.0711,
      "mae_dtheta": 0.020875707268714905,
      "mae_dx": 0.007262976840138435,
      "mae_dy": 0.002321414416655898,
      "pose_mae_dtheta": 0.1657397300004959,
      "pose_mae_dx": 0.04538535326719284,
      "pose_mae_dy": 0.03189081698656082,
      "pose_rmse_dtheta": 0.37285158038139343,
      "pose_rmse_dx": 0.13499747216701508,
      "pose_rmse_dy": 0.10259085893630981,
      "pose_rmse_mean": 0.20347997546195984,
      "rmse_dtheta": 0.03969884663820267,
      "rmse_dx": 0.017573753371834755,
      "rmse_dy": 0.004760268144309521,
      "rmse_mean": 0.02067762240767479,
      "rotation_flip": 0.003289473708719015,
      "sparse_tokens": 5011.0,
      "step": 9942,
      "turn_loss": 0.1692665070295334,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.46194945177476304,
      "grad_norm": 0.43172919750213623,
      "learning_rate": 7.2235698028299e-07,
      "loss": 0.1035,
      "mae_dtheta": 0.012868821620941162,
      "mae_dx": 0.0027669458650052547,
      "mae_dy": 0.0037681946996599436,
      "pose_mae_dtheta": 0.08544548600912094,
      "pose_mae_dx": 0.023646822199225426,
      "pose_mae_dy": 0.02365032583475113,
      "pose_rmse_dtheta": 0.2098519653081894,
      "pose_rmse_dx": 0.06800922006368637,
      "pose_rmse_dy": 0.0743846446275711,
      "pose_rmse_mean": 0.11741527169942856,
      "rmse_dtheta": 0.02927974984049797,
      "rmse_dx": 0.007218106649816036,
      "rmse_dy": 0.010411925613880157,
      "rmse_mean": 0.015636594966053963,
      "rotation_flip": 0.008210180327296257,
      "sparse_tokens": 32233.0,
      "step": 9943,
      "turn_loss": 0.1247258260846138,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4619959115406058,
      "grad_norm": 0.4352993071079254,
      "learning_rate": 7.216725435690752e-07,
      "loss": 0.0737,
      "mae_dtheta": 0.007263215724378824,
      "mae_dx": 0.0030322051607072353,
      "mae_dy": 0.00042257795576006174,
      "pose_mae_dtheta": 0.05057375133037567,
      "pose_mae_dx": 0.026734916493296623,
      "pose_mae_dy": 0.006029778625816107,
      "pose_rmse_dtheta": 0.23054182529449463,
      "pose_rmse_dx": 0.1127755269408226,
      "pose_rmse_dy": 0.01915142312645912,
      "pose_rmse_mean": 0.12082292884588242,
      "rmse_dtheta": 0.027725765481591225,
      "rmse_dx": 0.011336441151797771,
      "rmse_dy": 0.001123884110711515,
      "rmse_mean": 0.013395363464951515,
      "rotation_flip": 0.0021082221064716578,
      "sparse_tokens": 32169.0,
      "step": 9944,
      "turn_loss": 0.07750771939754486,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.4620423713064486,
      "grad_norm": 0.5904001593589783,
      "learning_rate": 7.209884060408945e-07,
      "loss": 0.1441,
      "mae_dtheta": 0.03176205977797508,
      "mae_dx": 0.005706928204745054,
      "mae_dy": 0.002977280644699931,
      "pose_mae_dtheta": 0.2223750650882721,
      "pose_mae_dx": 0.049927718937397,
      "pose_mae_dy": 0.03682764992117882,
      "pose_rmse_dtheta": 0.4248545467853546,
      "pose_rmse_dx": 0.11581163853406906,
      "pose_rmse_dy": 0.09710118174552917,
      "pose_rmse_mean": 0.2125891149044037,
      "rmse_dtheta": 0.05206775665283203,
      "rmse_dx": 0.014373010024428368,
      "rmse_dy": 0.0059807137586176395,
      "rmse_mean": 0.02414049580693245,
      "rotation_flip": 0.00988700520247221,
      "sparse_tokens": 11845.0,
      "step": 9945,
      "turn_loss": 0.19037388265132904,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4620888310722914,
      "grad_norm": 0.9118574261665344,
      "learning_rate": 7.203045677462922e-07,
      "loss": 0.1346,
      "mae_dtheta": 0.008714047260582447,
      "mae_dx": 0.001532627851702273,
      "mae_dy": 0.002628726651892066,
      "pose_mae_dtheta": 0.051436033099889755,
      "pose_mae_dx": 0.022875303402543068,
      "pose_mae_dy": 0.02730608358979225,
      "pose_rmse_dtheta": 0.09911016374826431,
      "pose_rmse_dx": 0.0581376813352108,
      "pose_rmse_dy": 0.059792228043079376,
      "pose_rmse_mean": 0.07234668731689453,
      "rmse_dtheta": 0.016778115183115005,
      "rmse_dx": 0.0038962936960160732,
      "rmse_dy": 0.0055821361020207405,
      "rmse_mean": 0.008752182126045227,
      "rotation_flip": 0.0020484807901084423,
      "sparse_tokens": 32089.0,
      "step": 9946,
      "turn_loss": 0.07838121801614761,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.46213529083813415,
      "grad_norm": 0.36795538663864136,
      "learning_rate": 7.196210287330873e-07,
      "loss": 0.1082,
      "mae_dtheta": 0.008791795000433922,
      "mae_dx": 0.0016569289145991206,
      "mae_dy": 0.002775243017822504,
      "pose_mae_dtheta": 0.05789416283369064,
      "pose_mae_dx": 0.023245714604854584,
      "pose_mae_dy": 0.02847493253648281,
      "pose_rmse_dtheta": 0.12034876644611359,
      "pose_rmse_dx": 0.055824048817157745,
      "pose_rmse_dy": 0.06296225637197495,
      "pose_rmse_mean": 0.07971169799566269,
      "rmse_dtheta": 0.018535060808062553,
      "rmse_dx": 0.004100834019482136,
      "rmse_dy": 0.0055703287944197655,
      "rmse_mean": 0.009402075782418251,
      "rotation_flip": 0.005105514079332352,
      "sparse_tokens": 32153.0,
      "step": 9947,
      "turn_loss": 0.08934801071882248,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.462181750603977,
      "grad_norm": 0.3962729573249817,
      "learning_rate": 7.189377890490829e-07,
      "loss": 0.0811,
      "mae_dtheta": 0.008113757707178593,
      "mae_dx": 0.0013546908739954233,
      "mae_dy": 0.0014305993681773543,
      "pose_mae_dtheta": 0.050405103713274,
      "pose_mae_dx": 0.013559694401919842,
      "pose_mae_dy": 0.017234135419130325,
      "pose_rmse_dtheta": 0.1399073302745819,
      "pose_rmse_dx": 0.038267832249403,
      "pose_rmse_dy": 0.04100556671619415,
      "pose_rmse_mean": 0.07306024432182312,
      "rmse_dtheta": 0.019497375935316086,
      "rmse_dx": 0.004588623996824026,
      "rmse_dy": 0.0030148366931825876,
      "rmse_mean": 0.00903361290693283,
      "rotation_flip": 0.003089143894612789,
      "sparse_tokens": 32105.0,
      "step": 9948,
      "turn_loss": 0.06149476021528244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.46222821036981976,
      "grad_norm": 0.6462230086326599,
      "learning_rate": 7.182548487420555e-07,
      "loss": 0.1594,
      "mae_dtheta": 0.03834233805537224,
      "mae_dx": 0.01122746616601944,
      "mae_dy": 0.0064375149086117744,
      "pose_mae_dtheta": 0.2829931378364563,
      "pose_mae_dx": 0.08019901067018509,
      "pose_mae_dy": 0.07392269372940063,
      "pose_rmse_dtheta": 0.48365312814712524,
      "pose_rmse_dx": 0.18511459231376648,
      "pose_rmse_dy": 0.15702813863754272,
      "pose_rmse_mean": 0.27526527643203735,
      "rmse_dtheta": 0.05478678643703461,
      "rmse_dx": 0.022694969549775124,
      "rmse_dy": 0.012480526231229305,
      "rmse_mean": 0.029987428337335587,
      "rotation_flip": 0.015570933930575848,
      "sparse_tokens": 9190.0,
      "step": 9949,
      "turn_loss": 0.31743717193603516,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.46227467013566254,
      "grad_norm": 0.3269817531108856,
      "learning_rate": 7.175722078597641e-07,
      "loss": 0.0973,
      "mae_dtheta": 0.009181826375424862,
      "mae_dx": 0.0015748837031424046,
      "mae_dy": 0.0019388688961043954,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3269817531108856,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 168.07928466796875,
      "model/head/act_norm_mean": 111.34805082070707,
      "model/head/act_norm_min": 52.163021087646484,
      "model/head/act_over_embed": 76.51942298086585,
      "model/head/grad_frac": 0.10419649630784988,
      "model/head/grad_norm": 0.03407035395503044,
      "model/head/grad_zero_frac": 0.00020559210679493845,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.70947265625,
      "model/head/update_ratio": 0.000580032414291054,
      "model/head/weight_delta": 9.94490909576416,
      "model/head/weight_delta_rel": 0.1744631677865982,
      "model/head/weight_norm": 58.73870849609375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42281875014305115,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.422760354987097,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226759672164917,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905248738919349,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10416649281978607,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03406054154038429,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5248603648190046,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010998075595125556,
      "model/modality_embedder.encoders.pose/weight_delta": 3.146801710128784,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10281582176685333,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969547271728516,
      "model/modality_embedder/grad_frac": 0.10416649281978607,
      "model/modality_embedder/grad_norm": 0.03406054154038429,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5248603648190046,
      "model/modality_embedder/update_ratio": 0.0010998075595125556,
      "model/modality_embedder/weight_delta": 3.146801710128784,
      "model/modality_embedder/weight_delta_rel": 0.10281582176685333,
      "model/modality_embedder/weight_norm": 30.969547271728516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 124.89625549316406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.682472041847042,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.044251441955566,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.27481650595378,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06328825652599335,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.020694104954600334,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003580939373932779,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007402354967780411,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7206125259399414,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09914076328277588,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95611000061035,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 126.60923767089844,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.616256814173482,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.396533012390137,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.916522143727285,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07009515166282654,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02291983552277088,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007700783899053931,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4496757984161377,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11949946731328964,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.762989044189453,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 129.51841735839844,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.374646765271766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.2943696975708,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.124904180428114,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07353275269269943,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.024043869227170944,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007823235355317593,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7360575199127197,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12544982135295868,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.73392105102539,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 125.8796157836914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.072475749559082,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.116415977478027,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.291668153755744,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07787945866584778,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.025465162470936775,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008502817945554852,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2096951007843018,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10969214886426926,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.949085235595703,
      "model/normalizer/grad_frac": 0.2502893805503845,
      "model/normalizer/grad_norm": 0.08184006065130234,
      "model/normalizer/grad_zero_frac": 0.000252892030403018,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010405711364001036,
      "model/normalizer/weight_delta": 6.753746509552002,
      "model/normalizer/weight_delta_rel": 0.08698434382677078,
      "model/normalizer/weight_norm": 78.649169921875,
      "pose_mae_dtheta": 0.06484004855155945,
      "pose_mae_dx": 0.01927393302321434,
      "pose_mae_dy": 0.024233002215623856,
      "pose_rmse_dtheta": 0.1770838052034378,
      "pose_rmse_dx": 0.0514817014336586,
      "pose_rmse_dy": 0.05881229415535927,
      "pose_rmse_mean": 0.09579260647296906,
      "rmse_dtheta": 0.030430827289819717,
      "rmse_dx": 0.004879433196038008,
      "rmse_dy": 0.004501853138208389,
      "rmse_mean": 0.013270705007016659,
      "rotation_flip": 0.005263158120214939,
      "sparse_tokens": 32089.0,
      "step": 9950,
      "turn_loss": 0.1521221250295639,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.4623211299015053,
      "grad_norm": 0.45718827843666077,
      "learning_rate": 7.168898664499485e-07,
      "loss": 0.1461,
      "mae_dtheta": 0.0436696782708168,
      "mae_dx": 0.008167977444827557,
      "mae_dy": 0.002553761238232255,
      "pose_mae_dtheta": 0.3400209844112396,
      "pose_mae_dx": 0.052602700889110565,
      "pose_mae_dy": 0.03379450738430023,
      "pose_rmse_dtheta": 0.5960719585418701,
      "pose_rmse_dx": 0.13731542229652405,
      "pose_rmse_dy": 0.08869979530572891,
      "pose_rmse_mean": 0.27402907609939575,
      "rmse_dtheta": 0.06741384416818619,
      "rmse_dx": 0.019035929813981056,
      "rmse_dy": 0.0051581477746367455,
      "rmse_mean": 0.030535973608493805,
      "rotation_flip": 0.015075377188622952,
      "sparse_tokens": 6301.0,
      "step": 9951,
      "turn_loss": 0.23025153577327728,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4623675896673481,
      "grad_norm": 0.38115978240966797,
      "learning_rate": 7.162078245603222e-07,
      "loss": 0.1055,
      "mae_dtheta": 0.010897885076701641,
      "mae_dx": 0.0017443408723920584,
      "mae_dy": 0.0023237881250679493,
      "pose_mae_dtheta": 0.07108158618211746,
      "pose_mae_dx": 0.015457995235919952,
      "pose_mae_dy": 0.022721828892827034,
      "pose_rmse_dtheta": 0.1903381645679474,
      "pose_rmse_dx": 0.03596990555524826,
      "pose_rmse_dy": 0.04917392507195473,
      "pose_rmse_mean": 0.09182733297348022,
      "rmse_dtheta": 0.02567853219807148,
      "rmse_dx": 0.006132504902780056,
      "rmse_dy": 0.005950655788183212,
      "rmse_mean": 0.012587230652570724,
      "rotation_flip": 0.003565062303096056,
      "sparse_tokens": 32169.0,
      "step": 9952,
      "turn_loss": 0.0969134271144867,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.46241404943319087,
      "grad_norm": 0.35108619928359985,
      "learning_rate": 7.155260822385828e-07,
      "loss": 0.0586,
      "mae_dtheta": 0.004805835895240307,
      "mae_dx": 0.0009169828263111413,
      "mae_dy": 0.0008143021841533482,
      "pose_mae_dtheta": 0.03429454565048218,
      "pose_mae_dx": 0.008794977329671383,
      "pose_mae_dy": 0.011294860392808914,
      "pose_rmse_dtheta": 0.09963846951723099,
      "pose_rmse_dx": 0.021505678072571754,
      "pose_rmse_dy": 0.031250644475221634,
      "pose_rmse_mean": 0.050798263400793076,
      "rmse_dtheta": 0.013817020691931248,
      "rmse_dx": 0.0029813465662300587,
      "rmse_dy": 0.0019458526512607932,
      "rmse_mean": 0.006248073652386665,
      "rotation_flip": 0.001957905013114214,
      "sparse_tokens": 32137.0,
      "step": 9953,
      "turn_loss": 0.03768575191497803,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.46246050919903364,
      "grad_norm": 0.5168364644050598,
      "learning_rate": 7.148446395324033e-07,
      "loss": 0.1162,
      "mae_dtheta": 0.009030040353536606,
      "mae_dx": 0.0017651015659794211,
      "mae_dy": 0.0017966594314202666,
      "pose_mae_dtheta": 0.05423973873257637,
      "pose_mae_dx": 0.021142246201634407,
      "pose_mae_dy": 0.020980453118681908,
      "pose_rmse_dtheta": 0.12432152777910233,
      "pose_rmse_dx": 0.0502253882586956,
      "pose_rmse_dy": 0.04818413406610489,
      "pose_rmse_mean": 0.0742436870932579,
      "rmse_dtheta": 0.019534429535269737,
      "rmse_dx": 0.005256111733615398,
      "rmse_dy": 0.0037175484467297792,
      "rmse_mean": 0.009502696804702282,
      "rotation_flip": 0.00559999980032444,
      "sparse_tokens": 32105.0,
      "step": 9954,
      "turn_loss": 0.07861839979887009,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4625069689648764,
      "grad_norm": 0.3441506624221802,
      "learning_rate": 7.141634964894389e-07,
      "loss": 0.0758,
      "mae_dtheta": 0.007764543406665325,
      "mae_dx": 0.001685246592387557,
      "mae_dy": 0.0016725341556593776,
      "pose_mae_dtheta": 0.05577434226870537,
      "pose_mae_dx": 0.02155166119337082,
      "pose_mae_dy": 0.01868036948144436,
      "pose_rmse_dtheta": 0.19962182641029358,
      "pose_rmse_dx": 0.07722078263759613,
      "pose_rmse_dy": 0.05583665519952774,
      "pose_rmse_mean": 0.11089308559894562,
      "rmse_dtheta": 0.022584497928619385,
      "rmse_dx": 0.005151808727532625,
      "rmse_dy": 0.005552912130951881,
      "rmse_mean": 0.011096405796706676,
      "rotation_flip": 0.006706908345222473,
      "sparse_tokens": 32089.0,
      "step": 9955,
      "turn_loss": 0.06111610308289528,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.4625534287307192,
      "grad_norm": 0.9777980446815491,
      "learning_rate": 7.134826531573208e-07,
      "loss": 0.2315,
      "mae_dtheta": 0.03288683667778969,
      "mae_dx": 0.013002818450331688,
      "mae_dy": 0.005810275208204985,
      "pose_mae_dtheta": 0.25714418292045593,
      "pose_mae_dx": 0.10374865680932999,
      "pose_mae_dy": 0.06575711071491241,
      "pose_rmse_dtheta": 0.45317888259887695,
      "pose_rmse_dx": 0.21133802831172943,
      "pose_rmse_dy": 0.16537028551101685,
      "pose_rmse_mean": 0.27662909030914307,
      "rmse_dtheta": 0.04994117468595505,
      "rmse_dx": 0.02501099556684494,
      "rmse_dy": 0.010608931072056293,
      "rmse_mean": 0.028520368039608,
      "rotation_flip": 0.009656652808189392,
      "sparse_tokens": 18087.0,
      "step": 9956,
      "turn_loss": 0.2554176449775696,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.462599888496562,
      "grad_norm": 0.47800156474113464,
      "learning_rate": 7.128021095836613e-07,
      "loss": 0.0685,
      "mae_dtheta": 0.008526688441634178,
      "mae_dx": 0.0012581817572936416,
      "mae_dy": 0.00021455358364619315,
      "pose_mae_dtheta": 0.06116653233766556,
      "pose_mae_dx": 0.010123620741069317,
      "pose_mae_dy": 0.0027920017018914223,
      "pose_rmse_dtheta": 0.2751843333244324,
      "pose_rmse_dx": 0.029415154829621315,
      "pose_rmse_dy": 0.005657358095049858,
      "pose_rmse_mean": 0.10341894626617432,
      "rmse_dtheta": 0.03209399804472923,
      "rmse_dx": 0.0040070004761219025,
      "rmse_dy": 0.00047305028419941664,
      "rmse_mean": 0.012191349640488625,
      "rotation_flip": 0.0019788919016718864,
      "sparse_tokens": 32201.0,
      "step": 9957,
      "turn_loss": 0.03553566709160805,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.46264634826240475,
      "grad_norm": 0.46376755833625793,
      "learning_rate": 7.121218658160528e-07,
      "loss": 0.1295,
      "mae_dtheta": 0.0062560089863836765,
      "mae_dx": 0.001192364376038313,
      "mae_dy": 0.000740143412258476,
      "pose_mae_dtheta": 0.04255283996462822,
      "pose_mae_dx": 0.010251878760755062,
      "pose_mae_dy": 0.010345186106860638,
      "pose_rmse_dtheta": 0.15302607417106628,
      "pose_rmse_dx": 0.025753475725650787,
      "pose_rmse_dy": 0.02715264819562435,
      "pose_rmse_mean": 0.06864406168460846,
      "rmse_dtheta": 0.020800812169909477,
      "rmse_dx": 0.004056870937347412,
      "rmse_dy": 0.0017167029436677694,
      "rmse_mean": 0.008858129382133484,
      "rotation_flip": 0.0015698587521910667,
      "sparse_tokens": 32153.0,
      "step": 9958,
      "turn_loss": 0.044496744871139526,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.4626928080282475,
      "grad_norm": 0.6244122385978699,
      "learning_rate": 7.114419219020618e-07,
      "loss": 0.1755,
      "mae_dtheta": 0.03365793079137802,
      "mae_dx": 0.008435961790382862,
      "mae_dy": 0.0036025643348693848,
      "pose_mae_dtheta": 0.26547476649284363,
      "pose_mae_dx": 0.060092099010944366,
      "pose_mae_dy": 0.04748097434639931,
      "pose_rmse_dtheta": 0.4957853853702545,
      "pose_rmse_dx": 0.16471295058727264,
      "pose_rmse_dy": 0.10641136020421982,
      "pose_rmse_mean": 0.2556365728378296,
      "rmse_dtheta": 0.05201795697212219,
      "rmse_dx": 0.019707944244146347,
      "rmse_dy": 0.007125931326299906,
      "rmse_mean": 0.02628394588828087,
      "rotation_flip": 0.008403361774981022,
      "sparse_tokens": 7881.0,
      "step": 9959,
      "turn_loss": 0.23118248581886292,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.4627392677940903,
      "grad_norm": 0.33897584676742554,
      "learning_rate": 7.107622778892409e-07,
      "loss": 0.0828,
      "mae_dtheta": 0.028020963072776794,
      "mae_dx": 0.01501801609992981,
      "mae_dy": 0.0037293757777661085,
      "pose_mae_dtheta": 0.202518031001091,
      "pose_mae_dx": 0.09272244572639465,
      "pose_mae_dy": 0.05269622430205345,
      "pose_rmse_dtheta": 0.3235902488231659,
      "pose_rmse_dx": 0.21355751156806946,
      "pose_rmse_dy": 0.10613828897476196,
      "pose_rmse_mean": 0.21442869305610657,
      "rmse_dtheta": 0.042566582560539246,
      "rmse_dx": 0.028839072212576866,
      "rmse_dy": 0.008207632228732109,
      "rmse_mean": 0.026537764817476273,
      "rotation_flip": 0.007481296546757221,
      "sparse_tokens": 7926.0,
      "step": 9960,
      "turn_loss": 0.2387848049402237,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.4627857275599331,
      "grad_norm": 0.4859713315963745,
      "learning_rate": 7.100829338251147e-07,
      "loss": 0.0845,
      "mae_dtheta": 0.042741794139146805,
      "mae_dx": 0.019468003883957863,
      "mae_dy": 0.005314403213560581,
      "pose_mae_dtheta": 0.3703966736793518,
      "pose_mae_dx": 0.16593074798583984,
      "pose_mae_dy": 0.06784746050834656,
      "pose_rmse_dtheta": 0.5939698815345764,
      "pose_rmse_dx": 0.2930337190628052,
      "pose_rmse_dy": 0.14960458874702454,
      "pose_rmse_mean": 0.34553608298301697,
      "rmse_dtheta": 0.060089875012636185,
      "rmse_dx": 0.03239016607403755,
      "rmse_dy": 0.009920047596096992,
      "rmse_mean": 0.034133363515138626,
      "rotation_flip": 0.013404825702309608,
      "sparse_tokens": 11921.0,
      "step": 9961,
      "turn_loss": 0.32024720311164856,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.46283218732577586,
      "grad_norm": 1.033434271812439,
      "learning_rate": 7.094038897571926e-07,
      "loss": 0.2167,
      "mae_dtheta": 0.032109200954437256,
      "mae_dx": 0.0060699982568621635,
      "mae_dy": 0.00320617132820189,
      "pose_mae_dtheta": 0.20313511788845062,
      "pose_mae_dx": 0.040663622319698334,
      "pose_mae_dy": 0.02819737233221531,
      "pose_rmse_dtheta": 0.3479714095592499,
      "pose_rmse_dx": 0.14196336269378662,
      "pose_rmse_dy": 0.05786876007914543,
      "pose_rmse_mean": 0.1826011836528778,
      "rmse_dtheta": 0.05022115260362625,
      "rmse_dx": 0.016266340389847755,
      "rmse_dy": 0.005647878162562847,
      "rmse_mean": 0.024045122787356377,
      "rotation_flip": 0.016483517363667488,
      "sparse_tokens": 5930.0,
      "step": 9962,
      "turn_loss": 0.2044316828250885,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.46287864709161863,
      "grad_norm": 0.43171876668930054,
      "learning_rate": 7.087251457329581e-07,
      "loss": 0.0751,
      "mae_dtheta": 0.009105570614337921,
      "mae_dx": 0.0014017911162227392,
      "mae_dy": 0.001359946676529944,
      "pose_mae_dtheta": 0.062220145016908646,
      "pose_mae_dx": 0.016416028141975403,
      "pose_mae_dy": 0.019132938235998154,
      "pose_rmse_dtheta": 0.1772715300321579,
      "pose_rmse_dx": 0.044565435498952866,
      "pose_rmse_dy": 0.053107693791389465,
      "pose_rmse_mean": 0.09164822101593018,
      "rmse_dtheta": 0.02516133151948452,
      "rmse_dx": 0.004509763792157173,
      "rmse_dy": 0.0034804525785148144,
      "rmse_mean": 0.011050516739487648,
      "rotation_flip": 0.0037735849618911743,
      "sparse_tokens": 32153.0,
      "step": 9963,
      "turn_loss": 0.05330091714859009,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 62507.0,
      "epoch": 0.46292510685746147,
      "grad_norm": 0.3448409140110016,
      "learning_rate": 7.080467017998788e-07,
      "loss": 0.0923,
      "mae_dtheta": 0.011412207037210464,
      "mae_dx": 0.0015411932254210114,
      "mae_dy": 0.002694892231374979,
      "pose_mae_dtheta": 0.07176274061203003,
      "pose_mae_dx": 0.019299663603305817,
      "pose_mae_dy": 0.028206592425704002,
      "pose_rmse_dtheta": 0.19203510880470276,
      "pose_rmse_dx": 0.04598269984126091,
      "pose_rmse_dy": 0.06016853079199791,
      "pose_rmse_mean": 0.09939544647932053,
      "rmse_dtheta": 0.02530938945710659,
      "rmse_dx": 0.004466338083148003,
      "rmse_dy": 0.005824706517159939,
      "rmse_mean": 0.011866811662912369,
      "rotation_flip": 0.006907137576490641,
      "sparse_tokens": 31907.0,
      "step": 9964,
      "turn_loss": 0.08407246321439743,
      "turns": 192.0,
      "turns_per_sample": 192.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.46297156662330424,
      "grad_norm": 0.6527852416038513,
      "learning_rate": 7.073685580053957e-07,
      "loss": 0.145,
      "mae_dtheta": 0.024285312741994858,
      "mae_dx": 0.006774439010769129,
      "mae_dy": 0.0046007828786969185,
      "pose_mae_dtheta": 0.18438299000263214,
      "pose_mae_dx": 0.044684164226055145,
      "pose_mae_dy": 0.06775753945112228,
      "pose_rmse_dtheta": 0.3577844500541687,
      "pose_rmse_dx": 0.10054811090230942,
      "pose_rmse_dy": 0.12637953460216522,
      "pose_rmse_mean": 0.19490402936935425,
      "rmse_dtheta": 0.039265040308237076,
      "rmse_dx": 0.015425162389874458,
      "rmse_dy": 0.007933547720313072,
      "rmse_mean": 0.020874585956335068,
      "rotation_flip": 0.006382978521287441,
      "sparse_tokens": 7959.0,
      "step": 9965,
      "turn_loss": 0.23433402180671692,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.463018026389147,
      "grad_norm": 0.785686194896698,
      "learning_rate": 7.066907143969353e-07,
      "loss": 0.164,
      "mae_dtheta": 0.02517755515873432,
      "mae_dx": 0.009263787418603897,
      "mae_dy": 0.003088311990723014,
      "pose_mae_dtheta": 0.20711959898471832,
      "pose_mae_dx": 0.06702229380607605,
      "pose_mae_dy": 0.035687077790498734,
      "pose_rmse_dtheta": 0.42691951990127563,
      "pose_rmse_dx": 0.15919488668441772,
      "pose_rmse_dy": 0.09352881461381912,
      "pose_rmse_mean": 0.2265477478504181,
      "rmse_dtheta": 0.04543674737215042,
      "rmse_dx": 0.02076936513185501,
      "rmse_dy": 0.00722678005695343,
      "rmse_mean": 0.024477630853652954,
      "rotation_flip": 0.014851485379040241,
      "sparse_tokens": 15061.0,
      "step": 9966,
      "turn_loss": 0.19691266119480133,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.4630644861549898,
      "grad_norm": 0.5589202642440796,
      "learning_rate": 7.060131710218959e-07,
      "loss": 0.0952,
      "mae_dtheta": 0.02136065810918808,
      "mae_dx": 0.008368715643882751,
      "mae_dy": 0.005718562752008438,
      "pose_mae_dtheta": 0.1517099142074585,
      "pose_mae_dx": 0.07067739218473434,
      "pose_mae_dy": 0.08176107704639435,
      "pose_rmse_dtheta": 0.2301556020975113,
      "pose_rmse_dx": 0.1751483827829361,
      "pose_rmse_dy": 0.19084179401397705,
      "pose_rmse_mean": 0.19871525466442108,
      "rmse_dtheta": 0.03357958421111107,
      "rmse_dx": 0.021856360137462616,
      "rmse_dy": 0.010610327124595642,
      "rmse_mean": 0.022015422582626343,
      "rotation_flip": 0.007326007355004549,
      "sparse_tokens": 4253.0,
      "step": 9967,
      "turn_loss": 0.23451337218284607,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4631109459208326,
      "grad_norm": 0.4252604842185974,
      "learning_rate": 7.053359279276611e-07,
      "loss": 0.1073,
      "mae_dtheta": 0.013228011317551136,
      "mae_dx": 0.002122921170666814,
      "mae_dy": 0.003718688851222396,
      "pose_mae_dtheta": 0.08817747980356216,
      "pose_mae_dx": 0.030385538935661316,
      "pose_mae_dy": 0.0399373322725296,
      "pose_rmse_dtheta": 0.22442401945590973,
      "pose_rmse_dx": 0.08191055804491043,
      "pose_rmse_dy": 0.09421985596418381,
      "pose_rmse_mean": 0.13351815938949585,
      "rmse_dtheta": 0.027495451271533966,
      "rmse_dx": 0.006146263796836138,
      "rmse_dy": 0.008432440459728241,
      "rmse_mean": 0.014024718664586544,
      "rotation_flip": 0.008309364318847656,
      "sparse_tokens": 32089.0,
      "step": 9968,
      "turn_loss": 0.1068020835518837,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.46315740568667535,
      "grad_norm": 0.7059004306793213,
      "learning_rate": 7.046589851615893e-07,
      "loss": 0.1567,
      "mae_dtheta": 0.02976914867758751,
      "mae_dx": 0.005373133346438408,
      "mae_dy": 0.0029576080851256847,
      "pose_mae_dtheta": 0.21749915182590485,
      "pose_mae_dx": 0.04023480787873268,
      "pose_mae_dy": 0.02706499956548214,
      "pose_rmse_dtheta": 0.41096246242523193,
      "pose_rmse_dx": 0.09496726840734482,
      "pose_rmse_dy": 0.06369480490684509,
      "pose_rmse_mean": 0.18987485766410828,
      "rmse_dtheta": 0.04848407953977585,
      "rmse_dx": 0.013672848232090473,
      "rmse_dy": 0.006129042711108923,
      "rmse_mean": 0.022761991247534752,
      "rotation_flip": 0.011705685406923294,
      "sparse_tokens": 10812.0,
      "step": 9969,
      "turn_loss": 0.2036433219909668,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.4632038654525181,
      "grad_norm": 0.5175273418426514,
      "learning_rate": 7.039823427710213e-07,
      "loss": 0.1269,
      "mae_dtheta": 0.03178367763757706,
      "mae_dx": 0.013192336075007915,
      "mae_dy": 0.004064149223268032,
      "pose_mae_dtheta": 0.26322823762893677,
      "pose_mae_dx": 0.09484219551086426,
      "pose_mae_dy": 0.05230778455734253,
      "pose_rmse_dtheta": 0.4872356057167053,
      "pose_rmse_dx": 0.20956836640834808,
      "pose_rmse_dy": 0.1357826292514801,
      "pose_rmse_mean": 0.27752888202667236,
      "rmse_dtheta": 0.05096004530787468,
      "rmse_dx": 0.025842925533652306,
      "rmse_dy": 0.008241081610321999,
      "rmse_mean": 0.02834801748394966,
      "rotation_flip": 0.008196720853447914,
      "sparse_tokens": 12893.0,
      "step": 9970,
      "turn_loss": 0.2154858261346817,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.4632503252183609,
      "grad_norm": 0.5591087937355042,
      "learning_rate": 7.033060008032721e-07,
      "loss": 0.1604,
      "mae_dtheta": 0.029010044410824776,
      "mae_dx": 0.008436176925897598,
      "mae_dy": 0.003937074914574623,
      "pose_mae_dtheta": 0.22598594427108765,
      "pose_mae_dx": 0.0636371299624443,
      "pose_mae_dy": 0.053979188203811646,
      "pose_rmse_dtheta": 0.4511941075325012,
      "pose_rmse_dx": 0.1682189702987671,
      "pose_rmse_dy": 0.16099371016025543,
      "pose_rmse_mean": 0.26013559103012085,
      "rmse_dtheta": 0.049532387405633926,
      "rmse_dx": 0.02030923031270504,
      "rmse_dy": 0.00943755079060793,
      "rmse_mean": 0.026426389813423157,
      "rotation_flip": 0.011224489659070969,
      "sparse_tokens": 19077.0,
      "step": 9971,
      "turn_loss": 0.19709165394306183,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4632967849842037,
      "grad_norm": 0.36930912733078003,
      "learning_rate": 7.026299593056424e-07,
      "loss": 0.0783,
      "mae_dtheta": 0.008299405686557293,
      "mae_dx": 0.0016361550660803914,
      "mae_dy": 0.0013348925858736038,
      "pose_mae_dtheta": 0.055189695209264755,
      "pose_mae_dx": 0.016014454886317253,
      "pose_mae_dy": 0.01928126998245716,
      "pose_rmse_dtheta": 0.14619918167591095,
      "pose_rmse_dx": 0.04635100066661835,
      "pose_rmse_dy": 0.05099102482199669,
      "pose_rmse_mean": 0.08118040859699249,
      "rmse_dtheta": 0.02012375369668007,
      "rmse_dx": 0.005745321046561003,
      "rmse_dy": 0.0037988158874213696,
      "rmse_mean": 0.009889297187328339,
      "rotation_flip": 0.0025316455867141485,
      "sparse_tokens": 32073.0,
      "step": 9972,
      "turn_loss": 0.06412279605865479,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.46334324475004646,
      "grad_norm": 0.9799439311027527,
      "learning_rate": 7.019542183254047e-07,
      "loss": 0.1325,
      "mae_dtheta": 0.05081915855407715,
      "mae_dx": 0.03179790824651718,
      "mae_dy": 0.010777452029287815,
      "pose_mae_dtheta": 0.3953762352466583,
      "pose_mae_dx": 0.24544988572597504,
      "pose_mae_dy": 0.16912145912647247,
      "pose_rmse_dtheta": 0.5814722180366516,
      "pose_rmse_dx": 0.3898299038410187,
      "pose_rmse_dy": 0.2924915552139282,
      "pose_rmse_mean": 0.4212645888328552,
      "rmse_dtheta": 0.06511198729276657,
      "rmse_dx": 0.04488060623407364,
      "rmse_dy": 0.016844838857650757,
      "rmse_mean": 0.04227914661169052,
      "rotation_flip": 0.01923076994717121,
      "sparse_tokens": 2728.0,
      "step": 9973,
      "turn_loss": 0.5896857976913452,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.46338970451588923,
      "grad_norm": 0.5319362878799438,
      "learning_rate": 7.012787779098162e-07,
      "loss": 0.1352,
      "mae_dtheta": 0.006242391187697649,
      "mae_dx": 0.0014335043961182237,
      "mae_dy": 0.000670860696118325,
      "pose_mae_dtheta": 0.043298859149217606,
      "pose_mae_dx": 0.012269524857401848,
      "pose_mae_dy": 0.01146554946899414,
      "pose_rmse_dtheta": 0.1283518671989441,
      "pose_rmse_dx": 0.033790405839681625,
      "pose_rmse_dy": 0.03374171629548073,
      "pose_rmse_mean": 0.06529466807842255,
      "rmse_dtheta": 0.018880289047956467,
      "rmse_dx": 0.004808079916983843,
      "rmse_dy": 0.001526156789623201,
      "rmse_mean": 0.008404841646552086,
      "rotation_flip": 0.002486016135662794,
      "sparse_tokens": 32137.0,
      "step": 9974,
      "turn_loss": 0.045627932995557785,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.463436164281732,
      "grad_norm": 0.4477212131023407,
      "learning_rate": 7.006036381061093e-07,
      "loss": 0.0879,
      "mae_dtheta": 0.027003513649106026,
      "mae_dx": 0.0072863451205194,
      "mae_dy": 0.0035404337104409933,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4477211833000183,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 138.23269653320312,
      "model/head/act_norm_mean": 104.96937779017857,
      "model/head/act_norm_min": 65.93807983398438,
      "model/head/act_over_embed": 72.13593915620889,
      "model/head/grad_frac": 0.08835937082767487,
      "model/head/grad_norm": 0.039560362696647644,
      "model/head/grad_zero_frac": 0.0001919494243338704,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6877790178571429,
      "model/head/update_ratio": 0.0006734944763593376,
      "model/head/weight_delta": 9.946407318115234,
      "model/head/weight_delta_rel": 0.17448943853378296,
      "model/head/weight_norm": 58.738956451416016,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42281103134155273,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227582613627116,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227089583873749,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905234351336564,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08414792269468307,
      "model/modality_embedder.encoders.pose/grad_norm": 0.037674807012081146,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5557725694444444,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012165064690634608,
      "model/modality_embedder.encoders.pose/weight_delta": 3.147311210632324,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10283246636390686,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96967315673828,
      "model/modality_embedder/grad_frac": 0.08414792269468307,
      "model/modality_embedder/grad_norm": 0.037674807012081146,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5557725694444444,
      "model/modality_embedder/update_ratio": 0.0012165064690634608,
      "model/modality_embedder/weight_delta": 3.147311210632324,
      "model/modality_embedder/weight_delta_rel": 0.10283246636390686,
      "model/modality_embedder/weight_norm": 30.96967315673828,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.35569763183594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.279508574263037,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.305475234985352,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.99789623842663,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05332531780004501,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.023874875158071518,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008540053968317807,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7214293479919434,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09917052835226059,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95635223388672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.02204132080078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.16248051303855,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.568615913391113,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.604682821266692,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.054459795355796814,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.024382803589105606,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008192233508452773,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4506313800811768,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11953257024288177,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.763317108154297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 82.83787536621094,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.896554350907028,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.042255401611328,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.796354597304962,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05263160541653633,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.023564284667372704,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007667109603062272,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.737177848815918,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12548743188381195,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.7342472076416,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.6667709350586,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.706023242630387,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.996978759765625,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.039838560211923,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05375325679779053,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.024066472426056862,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008035734063014388,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.210803985595703,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10973004251718521,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.94931411743164,
      "model/normalizer/grad_frac": 0.1934533715248108,
      "model/normalizer/grad_norm": 0.08661317080259323,
      "model/normalizer/grad_zero_frac": 0.00023043899273034185,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001101254834793508,
      "model/normalizer/weight_delta": 6.755825042724609,
      "model/normalizer/weight_delta_rel": 0.08701111376285553,
      "model/normalizer/weight_norm": 78.64952850341797,
      "pose_mae_dtheta": 0.2129105031490326,
      "pose_mae_dx": 0.04197091981768608,
      "pose_mae_dy": 0.04390736296772957,
      "pose_rmse_dtheta": 0.48929518461227417,
      "pose_rmse_dx": 0.11485984176397324,
      "pose_rmse_dy": 0.13403655588626862,
      "pose_rmse_mean": 0.24606385827064514,
      "rmse_dtheta": 0.05031995847821236,
      "rmse_dx": 0.01766454428434372,
      "rmse_dy": 0.008479084819555283,
      "rmse_mean": 0.02548786625266075,
      "rotation_flip": 0.003565062303096056,
      "sparse_tokens": 9646.0,
      "step": 9975,
      "turn_loss": 0.19381952285766602,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.4634826240475748,
      "grad_norm": 0.39463749527931213,
      "learning_rate": 6.999287989614972e-07,
      "loss": 0.0686,
      "mae_dtheta": 0.008603209629654884,
      "mae_dx": 0.0011649428633973002,
      "mae_dy": 0.0004655958618968725,
      "pose_mae_dtheta": 0.06659107655286789,
      "pose_mae_dx": 0.009726994670927525,
      "pose_mae_dy": 0.008282561786472797,
      "pose_rmse_dtheta": 0.28066515922546387,
      "pose_rmse_dx": 0.0217739325016737,
      "pose_rmse_dy": 0.026261020451784134,
      "pose_rmse_mean": 0.10956671088933945,
      "rmse_dtheta": 0.029844027012586594,
      "rmse_dx": 0.003154741134494543,
      "rmse_dy": 0.0010167327709496021,
      "rmse_mean": 0.011338500306010246,
      "rotation_flip": 0.00044984256965108216,
      "sparse_tokens": 32233.0,
      "step": 9976,
      "turn_loss": 0.04728883132338524,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.46352908381341756,
      "grad_norm": 0.37383705377578735,
      "learning_rate": 6.992542605231739e-07,
      "loss": 0.0757,
      "mae_dtheta": 0.007282870355993509,
      "mae_dx": 0.0011777711333706975,
      "mae_dy": 0.0002074350049952045,
      "pose_mae_dtheta": 0.05537692457437515,
      "pose_mae_dx": 0.009521577507257462,
      "pose_mae_dy": 0.002712664194405079,
      "pose_rmse_dtheta": 0.26062530279159546,
      "pose_rmse_dx": 0.01980656385421753,
      "pose_rmse_dy": 0.006216228939592838,
      "pose_rmse_mean": 0.09554936736822128,
      "rmse_dtheta": 0.028798332437872887,
      "rmse_dx": 0.003241979982703924,
      "rmse_dy": 0.0004924506065435708,
      "rmse_mean": 0.010844254866242409,
      "rotation_flip": 0.0011890606256201863,
      "sparse_tokens": 32217.0,
      "step": 9977,
      "turn_loss": 0.03638444468379021,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.46357554357926034,
      "grad_norm": 0.4916062653064728,
      "learning_rate": 6.985800228383072e-07,
      "loss": 0.1217,
      "mae_dtheta": 0.025014156475663185,
      "mae_dx": 0.009009512141346931,
      "mae_dy": 0.0029991690535098314,
      "pose_mae_dtheta": 0.1753409504890442,
      "pose_mae_dx": 0.07480122894048691,
      "pose_mae_dy": 0.027687447145581245,
      "pose_rmse_dtheta": 0.3599647879600525,
      "pose_rmse_dx": 0.183367520570755,
      "pose_rmse_dy": 0.05867740884423256,
      "pose_rmse_mean": 0.20066992938518524,
      "rmse_dtheta": 0.042907681316137314,
      "rmse_dx": 0.01973201520740986,
      "rmse_dy": 0.006223184522241354,
      "rmse_mean": 0.022954296320676804,
      "rotation_flip": 0.01149425283074379,
      "sparse_tokens": 13213.0,
      "step": 9978,
      "turn_loss": 0.1939736157655716,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.4636220033451031,
      "grad_norm": 0.5523791313171387,
      "learning_rate": 6.979060859540493e-07,
      "loss": 0.1237,
      "mae_dtheta": 0.03501687943935394,
      "mae_dx": 0.00892789289355278,
      "mae_dy": 0.006254882086068392,
      "pose_mae_dtheta": 0.3038777709007263,
      "pose_mae_dx": 0.06920862197875977,
      "pose_mae_dy": 0.08273864537477493,
      "pose_rmse_dtheta": 0.5335192084312439,
      "pose_rmse_dx": 0.17557384073734283,
      "pose_rmse_dy": 0.19226141273975372,
      "pose_rmse_mean": 0.30045148730278015,
      "rmse_dtheta": 0.054231543093919754,
      "rmse_dx": 0.02013520523905754,
      "rmse_dy": 0.011722956784069538,
      "rmse_mean": 0.028696570545434952,
      "rotation_flip": 0.03654485195875168,
      "sparse_tokens": 5243.0,
      "step": 9979,
      "turn_loss": 0.1672060638666153,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4636684631109459,
      "grad_norm": 0.36007171869277954,
      "learning_rate": 6.972324499175265e-07,
      "loss": 0.0622,
      "mae_dtheta": 0.006044007837772369,
      "mae_dx": 0.0011512049240991473,
      "mae_dy": 0.00021779615781269968,
      "pose_mae_dtheta": 0.04204200580716133,
      "pose_mae_dx": 0.0087837940081954,
      "pose_mae_dy": 0.0029975036159157753,
      "pose_rmse_dtheta": 0.20122158527374268,
      "pose_rmse_dx": 0.022165080532431602,
      "pose_rmse_dy": 0.006815214641392231,
      "pose_rmse_mean": 0.07673396170139313,
      "rmse_dtheta": 0.025396469980478287,
      "rmse_dx": 0.003691206919029355,
      "rmse_dy": 0.0004103523097001016,
      "rmse_mean": 0.009832676500082016,
      "rotation_flip": 0.002582311164587736,
      "sparse_tokens": 32185.0,
      "step": 9980,
      "turn_loss": 0.040774524211883545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4637149228767887,
      "grad_norm": 0.5218099355697632,
      "learning_rate": 6.965591147758482e-07,
      "loss": 0.1191,
      "mae_dtheta": 0.006897179875522852,
      "mae_dx": 0.0012824584264308214,
      "mae_dy": 0.001811584341339767,
      "pose_mae_dtheta": 0.04878881573677063,
      "pose_mae_dx": 0.014812687411904335,
      "pose_mae_dy": 0.020201221108436584,
      "pose_rmse_dtheta": 0.10997925698757172,
      "pose_rmse_dx": 0.0444972962141037,
      "pose_rmse_dy": 0.04880858212709427,
      "pose_rmse_mean": 0.06776171177625656,
      "rmse_dtheta": 0.01572567969560623,
      "rmse_dx": 0.004009687341749668,
      "rmse_dy": 0.004334454890340567,
      "rmse_mean": 0.008023274131119251,
      "rotation_flip": 0.004827031400054693,
      "sparse_tokens": 32121.0,
      "step": 9981,
      "turn_loss": 0.055948395282030106,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4637613826426315,
      "grad_norm": 0.5424176454544067,
      "learning_rate": 6.958860805761019e-07,
      "loss": 0.1242,
      "mae_dtheta": 0.013013316318392754,
      "mae_dx": 0.0016036233864724636,
      "mae_dy": 0.002852020785212517,
      "pose_mae_dtheta": 0.08623173087835312,
      "pose_mae_dx": 0.02311933971941471,
      "pose_mae_dy": 0.03187921270728111,
      "pose_rmse_dtheta": 0.21276788413524628,
      "pose_rmse_dx": 0.07602088153362274,
      "pose_rmse_dy": 0.07666254788637161,
      "pose_rmse_mean": 0.12181710451841354,
      "rmse_dtheta": 0.026627283543348312,
      "rmse_dx": 0.004729705862700939,
      "rmse_dy": 0.007218678016215563,
      "rmse_mean": 0.01285855658352375,
      "rotation_flip": 0.009177680127322674,
      "sparse_tokens": 32089.0,
      "step": 9982,
      "turn_loss": 0.105340376496315,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4638078424084743,
      "grad_norm": 0.4881526529788971,
      "learning_rate": 6.952133473653511e-07,
      "loss": 0.0937,
      "mae_dtheta": 0.008734642527997494,
      "mae_dx": 0.0015132853295654058,
      "mae_dy": 0.0025057143066078424,
      "pose_mae_dtheta": 0.059969525784254074,
      "pose_mae_dx": 0.025866318494081497,
      "pose_mae_dy": 0.026930956169962883,
      "pose_rmse_dtheta": 0.1570178121328354,
      "pose_rmse_dx": 0.07807830721139908,
      "pose_rmse_dy": 0.07532863318920135,
      "pose_rmse_mean": 0.10347491502761841,
      "rmse_dtheta": 0.020729660987854004,
      "rmse_dx": 0.003894924186170101,
      "rmse_dy": 0.006110718008130789,
      "rmse_mean": 0.010245101526379585,
      "rotation_flip": 0.003800475038588047,
      "sparse_tokens": 32057.0,
      "step": 9983,
      "turn_loss": 0.08020223677158356,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19742.0,
      "epoch": 0.46385430217431706,
      "grad_norm": 0.8694814443588257,
      "learning_rate": 6.945409151906424e-07,
      "loss": 0.3008,
      "mae_dtheta": 0.030487429350614548,
      "mae_dx": 0.013891620561480522,
      "mae_dy": 0.007899848744273186,
      "pose_mae_dtheta": 0.21604546904563904,
      "pose_mae_dx": 0.10877327620983124,
      "pose_mae_dy": 0.08624807745218277,
      "pose_rmse_dtheta": 0.38339942693710327,
      "pose_rmse_dx": 0.24419640004634857,
      "pose_rmse_dy": 0.19265629351139069,
      "pose_rmse_mean": 0.2734173834323883,
      "rmse_dtheta": 0.04586722329258919,
      "rmse_dx": 0.026967814192175865,
      "rmse_dy": 0.015265364199876785,
      "rmse_mean": 0.02936680242419243,
      "rotation_flip": 0.016853932291269302,
      "sparse_tokens": 16362.0,
      "step": 9984,
      "turn_loss": 0.2916678786277771,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.46390076194015983,
      "grad_norm": 0.30371183156967163,
      "learning_rate": 6.938687840989972e-07,
      "loss": 0.0774,
      "mae_dtheta": 0.007694616913795471,
      "mae_dx": 0.0010388829978182912,
      "mae_dy": 0.001185967237688601,
      "pose_mae_dtheta": 0.054397646337747574,
      "pose_mae_dx": 0.012704423628747463,
      "pose_mae_dy": 0.017818305641412735,
      "pose_rmse_dtheta": 0.18749399483203888,
      "pose_rmse_dx": 0.03486361354589462,
      "pose_rmse_dy": 0.049393828958272934,
      "pose_rmse_mean": 0.09058381617069244,
      "rmse_dtheta": 0.022184142842888832,
      "rmse_dx": 0.00315536605194211,
      "rmse_dy": 0.0028592387679964304,
      "rmse_mean": 0.009399582631886005,
      "rotation_flip": 0.00401606410741806,
      "sparse_tokens": 32089.0,
      "step": 9985,
      "turn_loss": 0.05016526207327843,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20710.0,
      "epoch": 0.4639472217060026,
      "grad_norm": 0.435464471578598,
      "learning_rate": 6.931969541374206e-07,
      "loss": 0.1075,
      "mae_dtheta": 0.03115926682949066,
      "mae_dx": 0.0088490080088377,
      "mae_dy": 0.0029624425806105137,
      "pose_mae_dtheta": 0.26903197169303894,
      "pose_mae_dx": 0.07467333972454071,
      "pose_mae_dy": 0.0399758517742157,
      "pose_rmse_dtheta": 0.5108839273452759,
      "pose_rmse_dx": 0.17429578304290771,
      "pose_rmse_dy": 0.11732862144708633,
      "pose_rmse_mean": 0.2675027847290039,
      "rmse_dtheta": 0.05166959762573242,
      "rmse_dx": 0.019925732165575027,
      "rmse_dy": 0.007178687956184149,
      "rmse_mean": 0.02625800482928753,
      "rotation_flip": 0.013513513840734959,
      "sparse_tokens": 17635.0,
      "step": 9986,
      "turn_loss": 0.21336552500724792,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4639936814718454,
      "grad_norm": 0.6309428215026855,
      "learning_rate": 6.925254253528912e-07,
      "loss": 0.1606,
      "mae_dtheta": 0.0089142806828022,
      "mae_dx": 0.001827648258768022,
      "mae_dy": 0.0013550162548199296,
      "pose_mae_dtheta": 0.06223262846469879,
      "pose_mae_dx": 0.02078104391694069,
      "pose_mae_dy": 0.02128419652581215,
      "pose_rmse_dtheta": 0.18596285581588745,
      "pose_rmse_dx": 0.06065152585506439,
      "pose_rmse_dy": 0.05906390771269798,
      "pose_rmse_mean": 0.10189276188611984,
      "rmse_dtheta": 0.023468153551220894,
      "rmse_dx": 0.006904396694153547,
      "rmse_dy": 0.003236400196328759,
      "rmse_mean": 0.011202983558177948,
      "rotation_flip": 0.001688238582573831,
      "sparse_tokens": 32073.0,
      "step": 9987,
      "turn_loss": 0.07102112472057343,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.46404014123768816,
      "grad_norm": 0.5238553285598755,
      "learning_rate": 6.918541977923709e-07,
      "loss": 0.1158,
      "mae_dtheta": 0.02930174395442009,
      "mae_dx": 0.005787370260804892,
      "mae_dy": 0.006789991166442633,
      "pose_mae_dtheta": 0.20127879083156586,
      "pose_mae_dx": 0.048352956771850586,
      "pose_mae_dy": 0.0666678324341774,
      "pose_rmse_dtheta": 0.37259453535079956,
      "pose_rmse_dx": 0.14264971017837524,
      "pose_rmse_dy": 0.1758100688457489,
      "pose_rmse_mean": 0.23035144805908203,
      "rmse_dtheta": 0.048531562089920044,
      "rmse_dx": 0.014654513448476791,
      "rmse_dy": 0.015908628702163696,
      "rmse_mean": 0.026364903897047043,
      "rotation_flip": 0.027173912152647972,
      "sparse_tokens": 8987.0,
      "step": 9988,
      "turn_loss": 0.19937559962272644,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.46408660100353094,
      "grad_norm": 0.3424854278564453,
      "learning_rate": 6.911832715028e-07,
      "loss": 0.0863,
      "mae_dtheta": 0.00933237187564373,
      "mae_dx": 0.0018768112640827894,
      "mae_dy": 0.0024406644515693188,
      "pose_mae_dtheta": 0.06295701116323471,
      "pose_mae_dx": 0.019191838800907135,
      "pose_mae_dy": 0.022267289459705353,
      "pose_rmse_dtheta": 0.16642695665359497,
      "pose_rmse_dx": 0.06010504812002182,
      "pose_rmse_dy": 0.0671575516462326,
      "pose_rmse_mean": 0.0978965163230896,
      "rmse_dtheta": 0.021835381165146828,
      "rmse_dx": 0.00654748547822237,
      "rmse_dy": 0.006253783591091633,
      "rmse_mean": 0.01154555007815361,
      "rotation_flip": 0.0054471176117658615,
      "sparse_tokens": 32073.0,
      "step": 9989,
      "turn_loss": 0.08118037134408951,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28785.0,
      "epoch": 0.4641330607693737,
      "grad_norm": 1.1904107332229614,
      "learning_rate": 6.905126465310947e-07,
      "loss": 0.3236,
      "mae_dtheta": 0.045347459614276886,
      "mae_dx": 0.01433359645307064,
      "mae_dy": 0.005688799079507589,
      "pose_mae_dtheta": 0.3810245394706726,
      "pose_mae_dx": 0.10770980268716812,
      "pose_mae_dy": 0.07106298953294754,
      "pose_rmse_dtheta": 0.635551393032074,
      "pose_rmse_dx": 0.23860256373882294,
      "pose_rmse_dy": 0.16506265103816986,
      "pose_rmse_mean": 0.346405565738678,
      "rmse_dtheta": 0.06440075486898422,
      "rmse_dx": 0.027443351224064827,
      "rmse_dy": 0.010747453197836876,
      "rmse_mean": 0.034197188913822174,
      "rotation_flip": 0.014084506779909134,
      "sparse_tokens": 23447.0,
      "step": 9990,
      "turn_loss": 0.35286256670951843,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 21747.0,
      "epoch": 0.4641795205352165,
      "grad_norm": 0.611004650592804,
      "learning_rate": 6.898423229241535e-07,
      "loss": 0.1731,
      "mae_dtheta": 0.036077700555324554,
      "mae_dx": 0.01155592780560255,
      "mae_dy": 0.0068919602781534195,
      "pose_mae_dtheta": 0.2632971405982971,
      "pose_mae_dx": 0.07785779982805252,
      "pose_mae_dy": 0.06123623251914978,
      "pose_rmse_dtheta": 0.46890977025032043,
      "pose_rmse_dx": 0.17243582010269165,
      "pose_rmse_dy": 0.13937821984291077,
      "pose_rmse_mean": 0.2602412700653076,
      "rmse_dtheta": 0.05456918105483055,
      "rmse_dx": 0.023939993232488632,
      "rmse_dy": 0.014058399945497513,
      "rmse_mean": 0.03085586056113243,
      "rotation_flip": 0.01285583060234785,
      "sparse_tokens": 17341.0,
      "step": 9991,
      "turn_loss": 0.3506489098072052,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.46422598030105927,
      "grad_norm": 0.5403105020523071,
      "learning_rate": 6.891723007288514e-07,
      "loss": 0.1677,
      "mae_dtheta": 0.015811862424016,
      "mae_dx": 0.003006505547091365,
      "mae_dy": 0.0052634640596807,
      "pose_mae_dtheta": 0.10767101496458054,
      "pose_mae_dx": 0.04125668480992317,
      "pose_mae_dy": 0.04453830420970917,
      "pose_rmse_dtheta": 0.2556172311306,
      "pose_rmse_dx": 0.09592399001121521,
      "pose_rmse_dy": 0.09349872916936874,
      "pose_rmse_mean": 0.1483466625213623,
      "rmse_dtheta": 0.03160066157579422,
      "rmse_dx": 0.007251609116792679,
      "rmse_dy": 0.00996386632323265,
      "rmse_mean": 0.01627204567193985,
      "rotation_flip": 0.01077726949006319,
      "sparse_tokens": 32121.0,
      "step": 9992,
      "turn_loss": 0.14878655970096588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.46427244006690205,
      "grad_norm": 0.37000954151153564,
      "learning_rate": 6.885025799920453e-07,
      "loss": 0.0806,
      "mae_dtheta": 0.03146453946828842,
      "mae_dx": 0.006039641797542572,
      "mae_dy": 0.0035117906518280506,
      "pose_mae_dtheta": 0.2846289873123169,
      "pose_mae_dx": 0.051421742886304855,
      "pose_mae_dy": 0.041336894035339355,
      "pose_rmse_dtheta": 0.5566666722297668,
      "pose_rmse_dx": 0.13343508541584015,
      "pose_rmse_dy": 0.11081714928150177,
      "pose_rmse_mean": 0.26697295904159546,
      "rmse_dtheta": 0.053770191967487335,
      "rmse_dx": 0.014775560237467289,
      "rmse_dy": 0.008496755734086037,
      "rmse_mean": 0.02568083629012108,
      "rotation_flip": 0.0041841003112494946,
      "sparse_tokens": 8415.0,
      "step": 9993,
      "turn_loss": 0.193380206823349,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.4643188998327448,
      "grad_norm": 0.42076364159584045,
      "learning_rate": 6.878331607605671e-07,
      "loss": 0.1084,
      "mae_dtheta": 0.037070710211992264,
      "mae_dx": 0.014326425269246101,
      "mae_dy": 0.002910616574808955,
      "pose_mae_dtheta": 0.3158462643623352,
      "pose_mae_dx": 0.10617174208164215,
      "pose_mae_dy": 0.04204273223876953,
      "pose_rmse_dtheta": 0.5342283844947815,
      "pose_rmse_dx": 0.2455967366695404,
      "pose_rmse_dy": 0.09057413041591644,
      "pose_rmse_mean": 0.2901330888271332,
      "rmse_dtheta": 0.05334026739001274,
      "rmse_dx": 0.02706834115087986,
      "rmse_dy": 0.00628751190379262,
      "rmse_mean": 0.028898708522319794,
      "rotation_flip": 0.01417525764554739,
      "sparse_tokens": 11864.0,
      "step": 9994,
      "turn_loss": 0.22860153019428253,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4643653595985876,
      "grad_norm": 0.3850667178630829,
      "learning_rate": 6.871640430812299e-07,
      "loss": 0.0941,
      "mae_dtheta": 0.007190326694399118,
      "mae_dx": 0.001225598738528788,
      "mae_dy": 0.0011519399704411626,
      "pose_mae_dtheta": 0.04906811565160751,
      "pose_mae_dx": 0.01127740740776062,
      "pose_mae_dy": 0.009963703341782093,
      "pose_rmse_dtheta": 0.18352550268173218,
      "pose_rmse_dx": 0.027908243238925934,
      "pose_rmse_dy": 0.02695453353226185,
      "pose_rmse_mean": 0.07946275919675827,
      "rmse_dtheta": 0.02263941615819931,
      "rmse_dx": 0.003931895829737186,
      "rmse_dy": 0.004283635411411524,
      "rmse_mean": 0.01028498262166977,
      "rotation_flip": 0.0032935363706201315,
      "sparse_tokens": 32185.0,
      "step": 9995,
      "turn_loss": 0.0497267059981823,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.4644118193644304,
      "grad_norm": 0.51368647813797,
      "learning_rate": 6.864952270008274e-07,
      "loss": 0.1122,
      "mae_dtheta": 0.028548840433359146,
      "mae_dx": 0.00792725570499897,
      "mae_dy": 0.0035801222547888756,
      "pose_mae_dtheta": 0.2173454761505127,
      "pose_mae_dx": 0.05543753504753113,
      "pose_mae_dy": 0.03867081552743912,
      "pose_rmse_dtheta": 0.4286329746246338,
      "pose_rmse_dx": 0.13595180213451385,
      "pose_rmse_dy": 0.08575510233640671,
      "pose_rmse_mean": 0.21677997708320618,
      "rmse_dtheta": 0.04698716849088669,
      "rmse_dx": 0.018603460863232613,
      "rmse_dy": 0.007124545518308878,
      "rmse_mean": 0.02423839084804058,
      "rotation_flip": 0.010335917584598064,
      "sparse_tokens": 8091.0,
      "step": 9996,
      "turn_loss": 0.18579159677028656,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4644582791302732,
      "grad_norm": 0.5293956995010376,
      "learning_rate": 6.858267125661272e-07,
      "loss": 0.124,
      "mae_dtheta": 0.011292547918856144,
      "mae_dx": 0.0021318451035767794,
      "mae_dy": 0.0025506799574941397,
      "pose_mae_dtheta": 0.06964771449565887,
      "pose_mae_dx": 0.020002184435725212,
      "pose_mae_dy": 0.024775661528110504,
      "pose_rmse_dtheta": 0.18806816637516022,
      "pose_rmse_dx": 0.04628987982869148,
      "pose_rmse_dy": 0.05765349045395851,
      "pose_rmse_mean": 0.09733717888593674,
      "rmse_dtheta": 0.024556627497076988,
      "rmse_dx": 0.006246706936508417,
      "rmse_dy": 0.006381665822118521,
      "rmse_mean": 0.012395000085234642,
      "rotation_flip": 0.00693962536752224,
      "sparse_tokens": 32153.0,
      "step": 9997,
      "turn_loss": 0.11045528948307037,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.464504738896116,
      "grad_norm": 0.432671457529068,
      "learning_rate": 6.851584998238825e-07,
      "loss": 0.1008,
      "mae_dtheta": 0.011772657744586468,
      "mae_dx": 0.001773641211912036,
      "mae_dy": 0.002349106129258871,
      "pose_mae_dtheta": 0.07739851623773575,
      "pose_mae_dx": 0.0237722210586071,
      "pose_mae_dy": 0.0257381834089756,
      "pose_rmse_dtheta": 0.21175120770931244,
      "pose_rmse_dx": 0.06314637511968613,
      "pose_rmse_dy": 0.05859267711639404,
      "pose_rmse_mean": 0.1111634224653244,
      "rmse_dtheta": 0.027919573709368706,
      "rmse_dx": 0.005043493118137121,
      "rmse_dy": 0.005843108519911766,
      "rmse_mean": 0.012935392558574677,
      "rotation_flip": 0.007207207381725311,
      "sparse_tokens": 32105.0,
      "step": 9998,
      "turn_loss": 0.0898115485906601,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.46455119866195876,
      "grad_norm": 0.5210039615631104,
      "learning_rate": 6.84490588820818e-07,
      "loss": 0.1458,
      "mae_dtheta": 0.02935110405087471,
      "mae_dx": 0.013087117113173008,
      "mae_dy": 0.005226478446274996,
      "pose_mae_dtheta": 0.2536172568798065,
      "pose_mae_dx": 0.08548113703727722,
      "pose_mae_dy": 0.06763192266225815,
      "pose_rmse_dtheta": 0.4858875274658203,
      "pose_rmse_dx": 0.2048933357000351,
      "pose_rmse_dy": 0.16353090107440948,
      "pose_rmse_mean": 0.2847706079483032,
      "rmse_dtheta": 0.04892382025718689,
      "rmse_dx": 0.025710633024573326,
      "rmse_dy": 0.010810192674398422,
      "rmse_mean": 0.02848154865205288,
      "rotation_flip": 0.00788436271250248,
      "sparse_tokens": 15385.0,
      "step": 9999,
      "turn_loss": 0.26766127347946167,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.46459765842780154,
      "grad_norm": 0.49791860580444336,
      "learning_rate": 6.838229796036444e-07,
      "loss": 0.1218,
      "mae_dtheta": 0.009527693502604961,
      "mae_dx": 0.0014603028539568186,
      "mae_dy": 0.002352867042645812,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.49791857600212097,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 167.60433959960938,
      "model/head/act_norm_mean": 110.68920651830808,
      "model/head/act_norm_min": 60.57416534423828,
      "model/head/act_over_embed": 76.06665900805973,
      "model/head/grad_frac": 0.10159097611904144,
      "model/head/grad_norm": 0.050584033131599426,
      "model/head/grad_zero_frac": 0.0001881421630969271,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7066268150252525,
      "model/head/update_ratio": 0.0008611629018560052,
      "model/head/weight_delta": 9.947802543640137,
      "model/head/weight_delta_rel": 0.17451392114162445,
      "model/head/weight_norm": 58.73921585083008,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42282602190971375,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42275659207305216,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226818084716797,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29052228798217433,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1275104433298111,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06348981708288193,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5349706589366516,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002050064504146576,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1474781036376953,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10283792018890381,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969669342041016,
      "model/modality_embedder/grad_frac": 0.1275104433298111,
      "model/modality_embedder/grad_norm": 0.06348981708288193,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5349706589366516,
      "model/modality_embedder/update_ratio": 0.002050064504146576,
      "model/modality_embedder/weight_delta": 3.1474781036376953,
      "model/modality_embedder/weight_delta_rel": 0.10283792018890381,
      "model/modality_embedder/weight_norm": 30.969669342041016,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 94.6947250366211,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.703044833253166,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.09859561920166,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.288954320813577,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06706614047288895,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03339347615838051,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011944827856495976,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.722177743911743,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09919779747724533,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.956432342529297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 95.75411224365234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.689198532948534,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.39418888092041,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.96664837576063,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07429766654968262,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03699418902397156,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012429370544850826,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4515233039855957,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11956346780061722,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.763526916503906,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 97.22384643554688,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.48938041125541,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.248345375061035,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.203750216101394,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06786969304084778,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.033793579787015915,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010995306074619293,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.738258123397827,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12552370131015778,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.73455047607422,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 97.7763442993164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.200038580246915,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.05823040008545,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.37933052526646,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05897257477045059,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.029363540932536125,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002975710085593164,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.000980433658696711,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2118358612060547,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10976530611515045,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.949542999267578,
      "model/normalizer/grad_frac": 0.24253423511981964,
      "model/normalizer/grad_norm": 0.12076230347156525,
      "model/normalizer/grad_zero_frac": 0.00025998245109803975,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0015354434726759791,
      "model/normalizer/weight_delta": 6.75774621963501,
      "model/normalizer/weight_delta_rel": 0.08703585714101791,
      "model/normalizer/weight_norm": 78.64978790283203,
      "pose_mae_dtheta": 0.06391560286283493,
      "pose_mae_dx": 0.023960424587130547,
      "pose_mae_dy": 0.030298946425318718,
      "pose_rmse_dtheta": 0.16326965391635895,
      "pose_rmse_dx": 0.06977497786283493,
      "pose_rmse_dy": 0.0793214961886406,
      "pose_rmse_mean": 0.10412204265594482,
      "rmse_dtheta": 0.021456418558955193,
      "rmse_dx": 0.004296015482395887,
      "rmse_dy": 0.005439916159957647,
      "rmse_mean": 0.010397450998425484,
      "rotation_flip": 0.004905660171061754,
      "sparse_tokens": 32089.0,
      "step": 10000,
      "turn_loss": 0.07773889601230621,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.46459765842780154,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3011658191680908,
      "eval_objectnav_nopose_mae_dtheta": 0.0399225652217865,
      "eval_objectnav_nopose_mae_dx": 0.013102279976010323,
      "eval_objectnav_nopose_mae_dy": 0.004845781251788139,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3191353678703308,
      "eval_objectnav_nopose_pose_mae_dx": 0.10445848107337952,
      "eval_objectnav_nopose_pose_mae_dy": 0.05383489280939102,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.54010009765625,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23012001812458038,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1262771338224411,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29883241653442383,
      "eval_objectnav_nopose_rmse_dtheta": 0.05767309293150902,
      "eval_objectnav_nopose_rmse_dx": 0.025629593059420586,
      "eval_objectnav_nopose_rmse_dy": 0.009839332662522793,
      "eval_objectnav_nopose_rmse_mean": 0.031047340482473373,
      "eval_objectnav_nopose_rotation_flip": 0.015415563248097897,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3011658191680908,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 10000
    },
    {
      "epoch": 0.46459765842780154,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.26954203844070435,
      "eval_objectnav_pose_mae_dtheta": 0.03501850739121437,
      "eval_objectnav_pose_mae_dx": 0.010931056924164295,
      "eval_objectnav_pose_mae_dy": 0.00447835261002183,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26166650652885437,
      "eval_objectnav_pose_pose_mae_dx": 0.08513887971639633,
      "eval_objectnav_pose_pose_mae_dy": 0.048460181802511215,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46237409114837646,
      "eval_objectnav_pose_pose_rmse_dx": 0.1986144632101059,
      "eval_objectnav_pose_pose_rmse_dy": 0.11898814141750336,
      "eval_objectnav_pose_pose_rmse_mean": 0.25999224185943604,
      "eval_objectnav_pose_rmse_dtheta": 0.052936092019081116,
      "eval_objectnav_pose_rmse_dx": 0.023049766197800636,
      "eval_objectnav_pose_rmse_dy": 0.009332071989774704,
      "eval_objectnav_pose_rmse_mean": 0.02843930944800377,
      "eval_objectnav_pose_rotation_flip": 0.01524360291659832,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.26954203844070435,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 10000
    },
    {
      "epoch": 0.46459765842780154,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08754608780145645,
      "eval_pointnav_mae_dtheta": 0.010113202035427094,
      "eval_pointnav_mae_dx": 0.0021846205927431583,
      "eval_pointnav_mae_dy": 0.002294656354933977,
      "eval_pointnav_pose_mae_dtheta": 0.06903105229139328,
      "eval_pointnav_pose_mae_dx": 0.024250268936157227,
      "eval_pointnav_pose_mae_dy": 0.02398139238357544,
      "eval_pointnav_pose_rmse_dtheta": 0.20157185196876526,
      "eval_pointnav_pose_rmse_dx": 0.07560867816209793,
      "eval_pointnav_pose_rmse_dy": 0.07026104629039764,
      "eval_pointnav_pose_rmse_mean": 0.11581385135650635,
      "eval_pointnav_rmse_dtheta": 0.02512514591217041,
      "eval_pointnav_rmse_dx": 0.0070487442426383495,
      "eval_pointnav_rmse_dy": 0.006237206980586052,
      "eval_pointnav_rmse_mean": 0.012803698889911175,
      "eval_pointnav_rotation_flip": 0.005274731665849686,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08754608780145645,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 10000
    },
    {
      "epoch": 0.46459765842780154,
      "eval_loss": 0.2194179818034172,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3011658191680908,
      "eval_objectnav_nopose_mae_dtheta": 0.0399225652217865,
      "eval_objectnav_nopose_mae_dx": 0.013102279976010323,
      "eval_objectnav_nopose_mae_dy": 0.004845781251788139,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3191353678703308,
      "eval_objectnav_nopose_pose_mae_dx": 0.10445848107337952,
      "eval_objectnav_nopose_pose_mae_dy": 0.05383489280939102,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.54010009765625,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23012001812458038,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1262771338224411,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29883241653442383,
      "eval_objectnav_nopose_rmse_dtheta": 0.05767309293150902,
      "eval_objectnav_nopose_rmse_dx": 0.025629593059420586,
      "eval_objectnav_nopose_rmse_dy": 0.009839332662522793,
      "eval_objectnav_nopose_rmse_mean": 0.031047340482473373,
      "eval_objectnav_nopose_rotation_flip": 0.015415563248097897,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3011658191680908,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.26954203844070435,
      "eval_objectnav_pose_mae_dtheta": 0.03501850739121437,
      "eval_objectnav_pose_mae_dx": 0.010931056924164295,
      "eval_objectnav_pose_mae_dy": 0.00447835261002183,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26166650652885437,
      "eval_objectnav_pose_pose_mae_dx": 0.08513887971639633,
      "eval_objectnav_pose_pose_mae_dy": 0.048460181802511215,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46237409114837646,
      "eval_objectnav_pose_pose_rmse_dx": 0.1986144632101059,
      "eval_objectnav_pose_pose_rmse_dy": 0.11898814141750336,
      "eval_objectnav_pose_pose_rmse_mean": 0.25999224185943604,
      "eval_objectnav_pose_rmse_dtheta": 0.052936092019081116,
      "eval_objectnav_pose_rmse_dx": 0.023049766197800636,
      "eval_objectnav_pose_rmse_dy": 0.009332071989774704,
      "eval_objectnav_pose_rmse_mean": 0.02843930944800377,
      "eval_objectnav_pose_rotation_flip": 0.01524360291659832,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.26954203844070435,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08754608780145645,
      "eval_pointnav_mae_dtheta": 0.010113202035427094,
      "eval_pointnav_mae_dx": 0.0021846205927431583,
      "eval_pointnav_mae_dy": 0.002294656354933977,
      "eval_pointnav_pose_mae_dtheta": 0.06903105229139328,
      "eval_pointnav_pose_mae_dx": 0.024250268936157227,
      "eval_pointnav_pose_mae_dy": 0.02398139238357544,
      "eval_pointnav_pose_rmse_dtheta": 0.20157185196876526,
      "eval_pointnav_pose_rmse_dx": 0.07560867816209793,
      "eval_pointnav_pose_rmse_dy": 0.07026104629039764,
      "eval_pointnav_pose_rmse_mean": 0.11581385135650635,
      "eval_pointnav_rmse_dtheta": 0.02512514591217041,
      "eval_pointnav_rmse_dx": 0.0070487442426383495,
      "eval_pointnav_rmse_dy": 0.006237206980586052,
      "eval_pointnav_rmse_mean": 0.012803698889911175,
      "eval_pointnav_rotation_flip": 0.005274731665849686,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08754608780145645,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 10000
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4646441181936443,
      "grad_norm": 0.3664664924144745,
      "learning_rate": 6.831556722190453e-07,
      "loss": 0.0933,
      "mae_dtheta": 0.010172490030527115,
      "mae_dx": 0.0009415451204404235,
      "mae_dy": 0.002047082409262657,
      "pose_mae_dtheta": 0.06803832203149796,
      "pose_mae_dx": 0.01551985926926136,
      "pose_mae_dy": 0.03137756139039993,
      "pose_rmse_dtheta": 0.14768855273723602,
      "pose_rmse_dx": 0.03998083993792534,
      "pose_rmse_dy": 0.0707390308380127,
      "pose_rmse_mean": 0.08613614737987518,
      "rmse_dtheta": 0.021307263523340225,
      "rmse_dx": 0.003230404108762741,
      "rmse_dy": 0.004580554086714983,
      "rmse_mean": 0.009706074371933937,
      "rotation_flip": 0.007398273795843124,
      "sparse_tokens": 32041.0,
      "step": 10001,
      "turn_loss": 0.06801257282495499,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4646905779594871,
      "grad_norm": 0.35550227761268616,
      "learning_rate": 6.824886667136881e-07,
      "loss": 0.0599,
      "mae_dtheta": 0.009443515911698341,
      "mae_dx": 0.0013352218084037304,
      "mae_dy": 0.0023250202648341656,
      "pose_mae_dtheta": 0.06683885306119919,
      "pose_mae_dx": 0.01883653737604618,
      "pose_mae_dy": 0.025427013635635376,
      "pose_rmse_dtheta": 0.1799064427614212,
      "pose_rmse_dx": 0.05708248168230057,
      "pose_rmse_dy": 0.05988604947924614,
      "pose_rmse_mean": 0.0989583283662796,
      "rmse_dtheta": 0.021679885685443878,
      "rmse_dx": 0.0037604765966534615,
      "rmse_dy": 0.0057932171039283276,
      "rmse_mean": 0.01041119359433651,
      "rotation_flip": 0.003992015961557627,
      "sparse_tokens": 32105.0,
      "step": 10002,
      "turn_loss": 0.07597368210554123,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.46473703772532987,
      "grad_norm": 0.5133144855499268,
      "learning_rate": 6.818219631342149e-07,
      "loss": 0.1023,
      "mae_dtheta": 0.007625553756952286,
      "mae_dx": 0.0011105978628620505,
      "mae_dy": 0.001295846770517528,
      "pose_mae_dtheta": 0.052351199090480804,
      "pose_mae_dx": 0.012215841561555862,
      "pose_mae_dy": 0.0168903861194849,
      "pose_rmse_dtheta": 0.16928835213184357,
      "pose_rmse_dx": 0.03660300746560097,
      "pose_rmse_dy": 0.0422731414437294,
      "pose_rmse_mean": 0.08272150158882141,
      "rmse_dtheta": 0.021457836031913757,
      "rmse_dx": 0.003612135536968708,
      "rmse_dy": 0.003000566503033042,
      "rmse_mean": 0.00935684610158205,
      "rotation_flip": 0.0020779219921678305,
      "sparse_tokens": 32073.0,
      "step": 10003,
      "turn_loss": 0.05861892178654671,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.46478349749117265,
      "grad_norm": 0.5396008491516113,
      "learning_rate": 6.811555615272503e-07,
      "loss": 0.0758,
      "mae_dtheta": 0.009965945035219193,
      "mae_dx": 0.0017257729778066278,
      "mae_dy": 0.002505438169464469,
      "pose_mae_dtheta": 0.07078875601291656,
      "pose_mae_dx": 0.01932160183787346,
      "pose_mae_dy": 0.026588287204504013,
      "pose_rmse_dtheta": 0.22358810901641846,
      "pose_rmse_dx": 0.05327294021844864,
      "pose_rmse_dy": 0.09020422399044037,
      "pose_rmse_mean": 0.12235508859157562,
      "rmse_dtheta": 0.02556721307337284,
      "rmse_dx": 0.0069263470359146595,
      "rmse_dy": 0.006713755428791046,
      "rmse_mean": 0.01306910626590252,
      "rotation_flip": 0.003150315023958683,
      "sparse_tokens": 32073.0,
      "step": 10004,
      "turn_loss": 0.07743529975414276,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.4648299572570154,
      "grad_norm": 1.2387213706970215,
      "learning_rate": 6.804894619393942e-07,
      "loss": 0.2718,
      "mae_dtheta": 0.031056473031640053,
      "mae_dx": 0.019916333258152008,
      "mae_dy": 0.007005565799772739,
      "pose_mae_dtheta": 0.2305130511522293,
      "pose_mae_dx": 0.16204430162906647,
      "pose_mae_dy": 0.09868781268596649,
      "pose_rmse_dtheta": 0.4242978096008301,
      "pose_rmse_dx": 0.32017382979393005,
      "pose_rmse_dy": 0.17329567670822144,
      "pose_rmse_mean": 0.3059224486351013,
      "rmse_dtheta": 0.04844587296247482,
      "rmse_dx": 0.03428519517183304,
      "rmse_dy": 0.011339562013745308,
      "rmse_mean": 0.03135687857866287,
      "rotation_flip": 0.006172839552164078,
      "sparse_tokens": 6190.0,
      "step": 10005,
      "turn_loss": 0.2714582681655884,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.4648764170228582,
      "grad_norm": 0.51277095079422,
      "learning_rate": 6.798236644172301e-07,
      "loss": 0.1306,
      "mae_dtheta": 0.02628442645072937,
      "mae_dx": 0.00830779504030943,
      "mae_dy": 0.003135070903226733,
      "pose_mae_dtheta": 0.188839390873909,
      "pose_mae_dx": 0.0769796222448349,
      "pose_mae_dy": 0.03614188730716705,
      "pose_rmse_dtheta": 0.37041613459587097,
      "pose_rmse_dx": 0.18352872133255005,
      "pose_rmse_dy": 0.08306398242712021,
      "pose_rmse_mean": 0.21233627200126648,
      "rmse_dtheta": 0.04474112018942833,
      "rmse_dx": 0.019195279106497765,
      "rmse_dy": 0.0065165371634066105,
      "rmse_mean": 0.023484311997890472,
      "rotation_flip": 0.005347593687474728,
      "sparse_tokens": 10195.0,
      "step": 10006,
      "turn_loss": 0.24198216199874878,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.464922876788701,
      "grad_norm": 0.5935545563697815,
      "learning_rate": 6.791581690073145e-07,
      "loss": 0.1345,
      "mae_dtheta": 0.036519814282655716,
      "mae_dx": 0.015499047935009003,
      "mae_dy": 0.00739894388243556,
      "pose_mae_dtheta": 0.2704225182533264,
      "pose_mae_dx": 0.1354030817747116,
      "pose_mae_dy": 0.06254284083843231,
      "pose_rmse_dtheta": 0.44393619894981384,
      "pose_rmse_dx": 0.26195237040519714,
      "pose_rmse_dy": 0.12762345373630524,
      "pose_rmse_mean": 0.277837336063385,
      "rmse_dtheta": 0.05231769010424614,
      "rmse_dx": 0.028183842077851295,
      "rmse_dy": 0.01360809151083231,
      "rmse_mean": 0.031369876116514206,
      "rotation_flip": 0.017910446971654892,
      "sparse_tokens": 10618.0,
      "step": 10007,
      "turn_loss": 0.3752419054508209,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.46496933655454376,
      "grad_norm": 0.3339274823665619,
      "learning_rate": 6.784929757561881e-07,
      "loss": 0.0909,
      "mae_dtheta": 0.011933289468288422,
      "mae_dx": 0.0017870074370875955,
      "mae_dy": 0.003024701727554202,
      "pose_mae_dtheta": 0.08216988295316696,
      "pose_mae_dx": 0.022100919857621193,
      "pose_mae_dy": 0.029415801167488098,
      "pose_rmse_dtheta": 0.22912882268428802,
      "pose_rmse_dx": 0.06081357225775719,
      "pose_rmse_dy": 0.06833516061306,
      "pose_rmse_mean": 0.11942585557699203,
      "rmse_dtheta": 0.02591395564377308,
      "rmse_dx": 0.006417497526854277,
      "rmse_dy": 0.008123237639665604,
      "rmse_mean": 0.013484897091984749,
      "rotation_flip": 0.007001166697591543,
      "sparse_tokens": 32041.0,
      "step": 10008,
      "turn_loss": 0.10087640583515167,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.46501579632038653,
      "grad_norm": 0.3477228581905365,
      "learning_rate": 6.778280847103668e-07,
      "loss": 0.0906,
      "mae_dtheta": 0.026653585955500603,
      "mae_dx": 0.010907485149800777,
      "mae_dy": 0.0035276475828140974,
      "pose_mae_dtheta": 0.19562973082065582,
      "pose_mae_dx": 0.07879219949245453,
      "pose_mae_dy": 0.04527152702212334,
      "pose_rmse_dtheta": 0.38887259364128113,
      "pose_rmse_dx": 0.2103128880262375,
      "pose_rmse_dy": 0.11226862668991089,
      "pose_rmse_mean": 0.2371513694524765,
      "rmse_dtheta": 0.044570013880729675,
      "rmse_dx": 0.02426132932305336,
      "rmse_dy": 0.006981509272009134,
      "rmse_mean": 0.02527095004916191,
      "rotation_flip": 0.011520737782120705,
      "sparse_tokens": 15589.0,
      "step": 10009,
      "turn_loss": 0.17829357087612152,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4650622560862293,
      "grad_norm": 0.4238725006580353,
      "learning_rate": 6.771634959163481e-07,
      "loss": 0.1332,
      "mae_dtheta": 0.007622321601957083,
      "mae_dx": 0.001198809826746583,
      "mae_dy": 0.0019312481163069606,
      "pose_mae_dtheta": 0.048313483595848083,
      "pose_mae_dx": 0.017346927896142006,
      "pose_mae_dy": 0.02554132416844368,
      "pose_rmse_dtheta": 0.09492702782154083,
      "pose_rmse_dx": 0.0454002320766449,
      "pose_rmse_dy": 0.0623483881354332,
      "pose_rmse_mean": 0.06755854934453964,
      "rmse_dtheta": 0.01472784299403429,
      "rmse_dx": 0.00337561359629035,
      "rmse_dy": 0.004152372013777494,
      "rmse_mean": 0.007418609689921141,
      "rotation_flip": 0.0028676772490143776,
      "sparse_tokens": 32073.0,
      "step": 10010,
      "turn_loss": 0.062086913734674454,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4651087158520721,
      "grad_norm": 0.47134992480278015,
      "learning_rate": 6.764992094206052e-07,
      "loss": 0.1046,
      "mae_dtheta": 0.01122208684682846,
      "mae_dx": 0.0025122682563960552,
      "mae_dy": 0.0040536681190133095,
      "pose_mae_dtheta": 0.06929026544094086,
      "pose_mae_dx": 0.03292312100529671,
      "pose_mae_dy": 0.03282012417912483,
      "pose_rmse_dtheta": 0.16595686972141266,
      "pose_rmse_dx": 0.09596820175647736,
      "pose_rmse_dy": 0.08659133315086365,
      "pose_rmse_mean": 0.11617213487625122,
      "rmse_dtheta": 0.023761238902807236,
      "rmse_dx": 0.006378509569913149,
      "rmse_dy": 0.009309419430792332,
      "rmse_mean": 0.01314972247928381,
      "rotation_flip": 0.008938147686421871,
      "sparse_tokens": 32105.0,
      "step": 10011,
      "turn_loss": 0.11412514746189117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.46515517561791486,
      "grad_norm": 0.6462268233299255,
      "learning_rate": 6.758352252695948e-07,
      "loss": 0.1476,
      "mae_dtheta": 0.010558942332863808,
      "mae_dx": 0.0018326719291508198,
      "mae_dy": 0.003125361166894436,
      "pose_mae_dtheta": 0.07289410382509232,
      "pose_mae_dx": 0.028973285108804703,
      "pose_mae_dy": 0.03247522562742233,
      "pose_rmse_dtheta": 0.1746969372034073,
      "pose_rmse_dx": 0.07496374845504761,
      "pose_rmse_dy": 0.07570460438728333,
      "pose_rmse_mean": 0.1084551066160202,
      "rmse_dtheta": 0.02241148054599762,
      "rmse_dx": 0.004736836068332195,
      "rmse_dy": 0.007052401080727577,
      "rmse_mean": 0.01140024047344923,
      "rotation_flip": 0.0022927015088498592,
      "sparse_tokens": 32121.0,
      "step": 10012,
      "turn_loss": 0.08010105788707733,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.46520163538375764,
      "grad_norm": 0.48466262221336365,
      "learning_rate": 6.751715435097467e-07,
      "loss": 0.1458,
      "mae_dtheta": 0.010523366741836071,
      "mae_dx": 0.0013624215498566628,
      "mae_dy": 0.00257612275891006,
      "pose_mae_dtheta": 0.06677326560020447,
      "pose_mae_dx": 0.020937109366059303,
      "pose_mae_dy": 0.03118273615837097,
      "pose_rmse_dtheta": 0.14801612496376038,
      "pose_rmse_dx": 0.05201714485883713,
      "pose_rmse_dy": 0.06971623748540878,
      "pose_rmse_mean": 0.08991651237010956,
      "rmse_dtheta": 0.021027615293860435,
      "rmse_dx": 0.003908681217581034,
      "rmse_dy": 0.005887459497898817,
      "rmse_mean": 0.010274585336446762,
      "rotation_flip": 0.0035984166897833347,
      "sparse_tokens": 32089.0,
      "step": 10013,
      "turn_loss": 0.07295140624046326,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.46524809514960047,
      "grad_norm": 0.6277090311050415,
      "learning_rate": 6.745081641874734e-07,
      "loss": 0.1212,
      "mae_dtheta": 0.02851608768105507,
      "mae_dx": 0.010012255050241947,
      "mae_dy": 0.005344639532268047,
      "pose_mae_dtheta": 0.21361926198005676,
      "pose_mae_dx": 0.08715832233428955,
      "pose_mae_dy": 0.06804889440536499,
      "pose_rmse_dtheta": 0.3751436173915863,
      "pose_rmse_dx": 0.21331846714019775,
      "pose_rmse_dy": 0.13968722522258759,
      "pose_rmse_mean": 0.2427164614200592,
      "rmse_dtheta": 0.04371771588921547,
      "rmse_dx": 0.021321861073374748,
      "rmse_dy": 0.010323850437998772,
      "rmse_mean": 0.025121143087744713,
      "rotation_flip": 0.00954653974622488,
      "sparse_tokens": 7410.0,
      "step": 10014,
      "turn_loss": 0.2178156077861786,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.46529455491544325,
      "grad_norm": 0.5902148485183716,
      "learning_rate": 6.738450873491675e-07,
      "loss": 0.1601,
      "mae_dtheta": 0.028190644457936287,
      "mae_dx": 0.009434694424271584,
      "mae_dy": 0.00515728397294879,
      "pose_mae_dtheta": 0.20570963621139526,
      "pose_mae_dx": 0.05751234292984009,
      "pose_mae_dy": 0.05084633454680443,
      "pose_rmse_dtheta": 0.3946179151535034,
      "pose_rmse_dx": 0.130722314119339,
      "pose_rmse_dy": 0.1341223120689392,
      "pose_rmse_mean": 0.21982084214687347,
      "rmse_dtheta": 0.04785612225532532,
      "rmse_dx": 0.019888417795300484,
      "rmse_dy": 0.011182347312569618,
      "rmse_mean": 0.02630896121263504,
      "rotation_flip": 0.020795660093426704,
      "sparse_tokens": 18011.0,
      "step": 10015,
      "turn_loss": 0.23814868927001953,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.465341014681286,
      "grad_norm": 0.49418944120407104,
      "learning_rate": 6.731823130411952e-07,
      "loss": 0.0914,
      "mae_dtheta": 0.007878977805376053,
      "mae_dx": 0.0013346377527341247,
      "mae_dy": 0.0024054916575551033,
      "pose_mae_dtheta": 0.04725182056427002,
      "pose_mae_dx": 0.020083121955394745,
      "pose_mae_dy": 0.024150151759386063,
      "pose_rmse_dtheta": 0.12701371312141418,
      "pose_rmse_dx": 0.06179262325167656,
      "pose_rmse_dy": 0.0559711791574955,
      "pose_rmse_mean": 0.08159250766038895,
      "rmse_dtheta": 0.01841849647462368,
      "rmse_dx": 0.0036990863736718893,
      "rmse_dy": 0.005775948520749807,
      "rmse_mean": 0.009297844022512436,
      "rotation_flip": 0.0046908315271139145,
      "sparse_tokens": 32057.0,
      "step": 10016,
      "turn_loss": 0.06461599469184875,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28553.0,
      "epoch": 0.4653874744471288,
      "grad_norm": 0.8530886769294739,
      "learning_rate": 6.725198413099071e-07,
      "loss": 0.2396,
      "mae_dtheta": 0.0366663858294487,
      "mae_dx": 0.01226214412599802,
      "mae_dy": 0.008172603324055672,
      "pose_mae_dtheta": 0.28743693232536316,
      "pose_mae_dx": 0.09555776417255402,
      "pose_mae_dy": 0.08891530334949493,
      "pose_rmse_dtheta": 0.48085135221481323,
      "pose_rmse_dx": 0.1887998878955841,
      "pose_rmse_dy": 0.20230761170387268,
      "pose_rmse_mean": 0.29065296053886414,
      "rmse_dtheta": 0.0535852387547493,
      "rmse_dx": 0.02384270541369915,
      "rmse_dy": 0.016873903572559357,
      "rmse_mean": 0.03143395110964775,
      "rotation_flip": 0.018802229315042496,
      "sparse_tokens": 23184.0,
      "step": 10017,
      "turn_loss": 0.34273698925971985,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 18185.0,
      "epoch": 0.4654339342129716,
      "grad_norm": 0.6186809539794922,
      "learning_rate": 6.718576722016284e-07,
      "loss": 0.1402,
      "mae_dtheta": 0.03358250856399536,
      "mae_dx": 0.00862963031977415,
      "mae_dy": 0.003032238455489278,
      "pose_mae_dtheta": 0.27298247814178467,
      "pose_mae_dx": 0.07257644087076187,
      "pose_mae_dy": 0.029752152040600777,
      "pose_rmse_dtheta": 0.5103821158409119,
      "pose_rmse_dx": 0.19249457120895386,
      "pose_rmse_dy": 0.07591397315263748,
      "pose_rmse_mean": 0.25959688425064087,
      "rmse_dtheta": 0.05499305948615074,
      "rmse_dx": 0.02036571130156517,
      "rmse_dy": 0.00720170047134161,
      "rmse_mean": 0.027520157396793365,
      "rotation_flip": 0.014475271105766296,
      "sparse_tokens": 12848.0,
      "step": 10018,
      "turn_loss": 0.24719075858592987,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.46548039397881436,
      "grad_norm": 0.5744408965110779,
      "learning_rate": 6.711958057626656e-07,
      "loss": 0.159,
      "mae_dtheta": 0.00918501429259777,
      "mae_dx": 0.0017726344522088766,
      "mae_dy": 0.0023271983955055475,
      "pose_mae_dtheta": 0.06457262486219406,
      "pose_mae_dx": 0.017037246376276016,
      "pose_mae_dy": 0.027737369760870934,
      "pose_rmse_dtheta": 0.14760860800743103,
      "pose_rmse_dx": 0.04579039290547371,
      "pose_rmse_dy": 0.0658646896481514,
      "pose_rmse_mean": 0.08642123639583588,
      "rmse_dtheta": 0.02024220861494541,
      "rmse_dx": 0.006422271952033043,
      "rmse_dy": 0.006594054400920868,
      "rmse_mean": 0.011086178943514824,
      "rotation_flip": 0.0023913909681141376,
      "sparse_tokens": 32121.0,
      "step": 10019,
      "turn_loss": 0.09230627119541168,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.46552685374465713,
      "grad_norm": 0.5144714117050171,
      "learning_rate": 6.705342420393047e-07,
      "loss": 0.1022,
      "mae_dtheta": 0.008937402628362179,
      "mae_dx": 0.0014911374310031533,
      "mae_dy": 0.002018885686993599,
      "pose_mae_dtheta": 0.057427313178777695,
      "pose_mae_dx": 0.014685830101370811,
      "pose_mae_dy": 0.02118978649377823,
      "pose_rmse_dtheta": 0.15195539593696594,
      "pose_rmse_dx": 0.03874589502811432,
      "pose_rmse_dy": 0.049493856728076935,
      "pose_rmse_mean": 0.080065056681633,
      "rmse_dtheta": 0.020416826009750366,
      "rmse_dx": 0.005080718547105789,
      "rmse_dy": 0.005617020186036825,
      "rmse_mean": 0.010371522046625614,
      "rotation_flip": 0.004899959079921246,
      "sparse_tokens": 32105.0,
      "step": 10020,
      "turn_loss": 0.07696843147277832,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.4655733135104999,
      "grad_norm": 0.5290760397911072,
      "learning_rate": 6.698729810778065e-07,
      "loss": 0.1312,
      "mae_dtheta": 0.04618755728006363,
      "mae_dx": 0.01451351959258318,
      "mae_dy": 0.004744785837829113,
      "pose_mae_dtheta": 0.40481090545654297,
      "pose_mae_dx": 0.11094178259372711,
      "pose_mae_dy": 0.05644000321626663,
      "pose_rmse_dtheta": 0.6288644075393677,
      "pose_rmse_dx": 0.24324800074100494,
      "pose_rmse_dy": 0.13668054342269897,
      "pose_rmse_mean": 0.33626431226730347,
      "rmse_dtheta": 0.06450093537569046,
      "rmse_dx": 0.02725868672132492,
      "rmse_dy": 0.009780346415936947,
      "rmse_mean": 0.0338466577231884,
      "rotation_flip": 0.008982036262750626,
      "sparse_tokens": 10277.0,
      "step": 10021,
      "turn_loss": 0.36532697081565857,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4656197732763427,
      "grad_norm": 0.42556488513946533,
      "learning_rate": 6.692120229244165e-07,
      "loss": 0.0717,
      "mae_dtheta": 0.01056651771068573,
      "mae_dx": 0.0016816628631204367,
      "mae_dy": 0.0029482580721378326,
      "pose_mae_dtheta": 0.07908576726913452,
      "pose_mae_dx": 0.021843452006578445,
      "pose_mae_dy": 0.02962636761367321,
      "pose_rmse_dtheta": 0.2142852395772934,
      "pose_rmse_dx": 0.058544568717479706,
      "pose_rmse_dy": 0.07482549548149109,
      "pose_rmse_mean": 0.11588510125875473,
      "rmse_dtheta": 0.023816106840968132,
      "rmse_dx": 0.004466341342777014,
      "rmse_dy": 0.007055607624351978,
      "rmse_mean": 0.011779352091252804,
      "rotation_flip": 0.003253354923799634,
      "sparse_tokens": 32089.0,
      "step": 10022,
      "turn_loss": 0.08139839768409729,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.46566623304218546,
      "grad_norm": 0.5404517650604248,
      "learning_rate": 6.68551367625353e-07,
      "loss": 0.115,
      "mae_dtheta": 0.005958104506134987,
      "mae_dx": 0.0010359996231272817,
      "mae_dy": 0.0009268827270716429,
      "pose_mae_dtheta": 0.04328848421573639,
      "pose_mae_dx": 0.011258670128881931,
      "pose_mae_dy": 0.013152829371392727,
      "pose_rmse_dtheta": 0.1604710966348648,
      "pose_rmse_dx": 0.03111598826944828,
      "pose_rmse_dy": 0.044707220047712326,
      "pose_rmse_mean": 0.07876477390527725,
      "rmse_dtheta": 0.018463725224137306,
      "rmse_dx": 0.003464250359684229,
      "rmse_dy": 0.0025640518870204687,
      "rmse_mean": 0.00816400907933712,
      "rotation_flip": 0.0026624067686498165,
      "sparse_tokens": 32089.0,
      "step": 10023,
      "turn_loss": 0.0433666929602623,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.46571269280802824,
      "grad_norm": 0.9843164682388306,
      "learning_rate": 6.678910152268181e-07,
      "loss": 0.2661,
      "mae_dtheta": 0.034911978989839554,
      "mae_dx": 0.013451684266328812,
      "mae_dy": 0.006360452622175217,
      "pose_mae_dtheta": 0.2766634225845337,
      "pose_mae_dx": 0.09302958101034164,
      "pose_mae_dy": 0.09555497020483017,
      "pose_rmse_dtheta": 0.45299476385116577,
      "pose_rmse_dx": 0.16788160800933838,
      "pose_rmse_dy": 0.177545964717865,
      "pose_rmse_mean": 0.26614078879356384,
      "rmse_dtheta": 0.050627000629901886,
      "rmse_dx": 0.023486804217100143,
      "rmse_dy": 0.00994341541081667,
      "rmse_mean": 0.028019074350595474,
      "rotation_flip": 0.0061349691823124886,
      "sparse_tokens": 5334.0,
      "step": 10024,
      "turn_loss": 0.41231536865234375,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.465759152573871,
      "grad_norm": 0.46259164810180664,
      "learning_rate": 6.672309657749887e-07,
      "loss": 0.0982,
      "mae_dtheta": 0.00642049266025424,
      "mae_dx": 0.0008468268206343055,
      "mae_dy": 0.0012909360229969025,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4625914990901947,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 172.45620727539062,
      "model/head/act_norm_mean": 121.88908617424242,
      "model/head/act_norm_min": 76.12201690673828,
      "model/head/act_over_embed": 83.76332116254316,
      "model/head/grad_frac": 0.08944391459226608,
      "model/head/grad_norm": 0.04137599468231201,
      "model/head/grad_zero_frac": 0.00022399387671612203,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7061631944444444,
      "model/head/update_ratio": 0.0007043980294838548,
      "model/head/weight_delta": 9.949424743652344,
      "model/head/weight_delta_rel": 0.1745423823595047,
      "model/head/weight_norm": 58.73950958251953,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228317141532898,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227554809012914,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226793348789215,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905215243745374,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07276070863008499,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03365848585963249,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5360837614155252,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010868215467780828,
      "model/modality_embedder.encoders.pose/weight_delta": 3.147702217102051,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10284524410963058,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969654083251953,
      "model/modality_embedder/grad_frac": 0.07276070863008499,
      "model/modality_embedder/grad_norm": 0.03365848585963249,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5360837614155252,
      "model/modality_embedder/update_ratio": 0.0010868215467780828,
      "model/modality_embedder/weight_delta": 3.147702217102051,
      "model/modality_embedder/weight_delta_rel": 0.10284524410963058,
      "model/modality_embedder/weight_norm": 30.969654083251953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 96.63716125488281,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.738651394901396,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.079183578491211,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.000632845479625,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.048610493540763855,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.022486800327897072,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008043480338528752,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7229409217834473,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09922561049461365,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.956554412841797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 97.84515380859375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.734540343915345,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.170644760131836,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.685017054901248,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.050714995712041855,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.023460326716303825,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007882174686528742,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4524412155151367,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11959525942802429,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.763774871826172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 99.48665618896484,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.554192720859387,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.485088348388672,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.93549920419115,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.049539968371391296,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0229167677462101,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007456284947693348,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7392828464508057,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12555812299251556,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.734832763671875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 100.18339538574219,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.20657968574635,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.21074390411377,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.07103499635197,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05097223445773125,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.023579321801662445,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007872962160035968,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2128243446350098,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1097990870475769,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.949745178222656,
      "model/normalizer/grad_frac": 0.15276890993118286,
      "model/normalizer/grad_norm": 0.07066959887742996,
      "model/normalizer/grad_zero_frac": 0.0002458015806041658,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0008985315798781812,
      "model/normalizer/weight_delta": 6.759629726409912,
      "model/normalizer/weight_delta_rel": 0.0870601162314415,
      "model/normalizer/weight_norm": 78.65010070800781,
      "pose_mae_dtheta": 0.03836800903081894,
      "pose_mae_dx": 0.011939247138798237,
      "pose_mae_dy": 0.015253882855176926,
      "pose_rmse_dtheta": 0.09940851479768753,
      "pose_rmse_dx": 0.03630860149860382,
      "pose_rmse_dy": 0.040679629892110825,
      "pose_rmse_mean": 0.05879892036318779,
      "rmse_dtheta": 0.016447097063064575,
      "rmse_dx": 0.0027113717515021563,
      "rmse_dy": 0.0034485317301005125,
      "rmse_mean": 0.007535667158663273,
      "rotation_flip": 0.0044820718467235565,
      "sparse_tokens": 32073.0,
      "step": 10025,
      "turn_loss": 0.04690012335777283,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.4658056123397138,
      "grad_norm": 0.4675907492637634,
      "learning_rate": 6.665712193160234e-07,
      "loss": 0.0915,
      "mae_dtheta": 0.03265783563256264,
      "mae_dx": 0.006685923784971237,
      "mae_dy": 0.003956081345677376,
      "pose_mae_dtheta": 0.24804887175559998,
      "pose_mae_dx": 0.06209367513656616,
      "pose_mae_dy": 0.04574853181838989,
      "pose_rmse_dtheta": 0.47888633608818054,
      "pose_rmse_dx": 0.17129716277122498,
      "pose_rmse_dy": 0.1335916668176651,
      "pose_rmse_mean": 0.26125839352607727,
      "rmse_dtheta": 0.054325491189956665,
      "rmse_dx": 0.017550699412822723,
      "rmse_dy": 0.009141302667558193,
      "rmse_mean": 0.027005832642316818,
      "rotation_flip": 0.027397260069847107,
      "sparse_tokens": 8903.0,
      "step": 10026,
      "turn_loss": 0.20971044898033142,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.46585207210555657,
      "grad_norm": 0.5347045063972473,
      "learning_rate": 6.659117758960598e-07,
      "loss": 0.1232,
      "mae_dtheta": 0.013735894113779068,
      "mae_dx": 0.0020449089352041483,
      "mae_dy": 0.0029293252155184746,
      "pose_mae_dtheta": 0.09855327755212784,
      "pose_mae_dx": 0.024903906509280205,
      "pose_mae_dy": 0.038204386830329895,
      "pose_rmse_dtheta": 0.23329786956310272,
      "pose_rmse_dx": 0.06364961713552475,
      "pose_rmse_dy": 0.10690555721521378,
      "pose_rmse_mean": 0.13461768627166748,
      "rmse_dtheta": 0.028472499921917915,
      "rmse_dx": 0.006352365482598543,
      "rmse_dy": 0.007729398086667061,
      "rmse_mean": 0.014184756204485893,
      "rotation_flip": 0.0031708283349871635,
      "sparse_tokens": 32121.0,
      "step": 10027,
      "turn_loss": 0.11438684910535812,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.46589853187139935,
      "grad_norm": 0.3667616844177246,
      "learning_rate": 6.65252635561211e-07,
      "loss": 0.1116,
      "mae_dtheta": 0.010127007961273193,
      "mae_dx": 0.002525312826037407,
      "mae_dy": 0.002903223969042301,
      "pose_mae_dtheta": 0.0695352628827095,
      "pose_mae_dx": 0.022498400881886482,
      "pose_mae_dy": 0.03079795651137829,
      "pose_rmse_dtheta": 0.16637861728668213,
      "pose_rmse_dx": 0.06254004687070847,
      "pose_rmse_dy": 0.09762062877416611,
      "pose_rmse_mean": 0.10884644091129303,
      "rmse_dtheta": 0.02022562548518181,
      "rmse_dx": 0.007125164847820997,
      "rmse_dy": 0.007802480366080999,
      "rmse_mean": 0.01171775721013546,
      "rotation_flip": 0.005816207733005285,
      "sparse_tokens": 32105.0,
      "step": 10028,
      "turn_loss": 0.09242856502532959,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4659449916372421,
      "grad_norm": 0.31203651428222656,
      "learning_rate": 6.645937983575729e-07,
      "loss": 0.0693,
      "mae_dtheta": 0.008115183562040329,
      "mae_dx": 0.0011870339512825012,
      "mae_dy": 0.001773499301634729,
      "pose_mae_dtheta": 0.052091799676418304,
      "pose_mae_dx": 0.013780324719846249,
      "pose_mae_dy": 0.02215343341231346,
      "pose_rmse_dtheta": 0.12698975205421448,
      "pose_rmse_dx": 0.03490179777145386,
      "pose_rmse_dy": 0.0566561184823513,
      "pose_rmse_mean": 0.07284922897815704,
      "rmse_dtheta": 0.01867361180484295,
      "rmse_dx": 0.003445700043812394,
      "rmse_dy": 0.0039787269197404385,
      "rmse_mean": 0.008699346333742142,
      "rotation_flip": 0.008303677663207054,
      "sparse_tokens": 32137.0,
      "step": 10029,
      "turn_loss": 0.07171156257390976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32338.0,
      "epoch": 0.46599145140308496,
      "grad_norm": 0.4951831102371216,
      "learning_rate": 6.639352643312164e-07,
      "loss": 0.1454,
      "mae_dtheta": 0.04094111546874046,
      "mae_dx": 0.011908398009836674,
      "mae_dy": 0.004735002294182777,
      "pose_mae_dtheta": 0.34508514404296875,
      "pose_mae_dx": 0.09201996773481369,
      "pose_mae_dy": 0.05726052075624466,
      "pose_rmse_dtheta": 0.5792526006698608,
      "pose_rmse_dx": 0.2025856077671051,
      "pose_rmse_dy": 0.13905449211597443,
      "pose_rmse_mean": 0.3069642186164856,
      "rmse_dtheta": 0.059117693454027176,
      "rmse_dx": 0.02392468973994255,
      "rmse_dy": 0.011062238365411758,
      "rmse_mean": 0.031368207186460495,
      "rotation_flip": 0.01718440093100071,
      "sparse_tokens": 26410.0,
      "step": 10030,
      "turn_loss": 0.30545464158058167,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.46603791116892773,
      "grad_norm": 0.7269614338874817,
      "learning_rate": 6.632770335281952e-07,
      "loss": 0.2095,
      "mae_dtheta": 0.029346197843551636,
      "mae_dx": 0.012198398821055889,
      "mae_dy": 0.004302993416786194,
      "pose_mae_dtheta": 0.23546816408634186,
      "pose_mae_dx": 0.09008985757827759,
      "pose_mae_dy": 0.05335886776447296,
      "pose_rmse_dtheta": 0.41111117601394653,
      "pose_rmse_dx": 0.196510910987854,
      "pose_rmse_dy": 0.10990417748689651,
      "pose_rmse_mean": 0.23917542397975922,
      "rmse_dtheta": 0.04635709896683693,
      "rmse_dx": 0.024294383823871613,
      "rmse_dy": 0.008085978217422962,
      "rmse_mean": 0.02624582313001156,
      "rotation_flip": 0.00824931263923645,
      "sparse_tokens": 17030.0,
      "step": 10031,
      "turn_loss": 0.2648161053657532,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.4660843709347705,
      "grad_norm": 0.8420698046684265,
      "learning_rate": 6.626191059945375e-07,
      "loss": 0.1535,
      "mae_dtheta": 0.03116552159190178,
      "mae_dx": 0.008593970909714699,
      "mae_dy": 0.0014634206891059875,
      "pose_mae_dtheta": 0.2282143384218216,
      "pose_mae_dx": 0.07044007629156113,
      "pose_mae_dy": 0.015510210767388344,
      "pose_rmse_dtheta": 0.4961077868938446,
      "pose_rmse_dx": 0.20081289112567902,
      "pose_rmse_dy": 0.043472517281770706,
      "pose_rmse_mean": 0.24679774045944214,
      "rmse_dtheta": 0.058716289699077606,
      "rmse_dx": 0.020912444218993187,
      "rmse_dy": 0.0031807711347937584,
      "rmse_mean": 0.02760316990315914,
      "rotation_flip": 0.003484320593997836,
      "sparse_tokens": 5931.0,
      "step": 10032,
      "turn_loss": 0.22879119217395782,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.4661308307006133,
      "grad_norm": 0.431651771068573,
      "learning_rate": 6.619614817762537e-07,
      "loss": 0.1169,
      "mae_dtheta": 0.026642808690667152,
      "mae_dx": 0.011847855523228645,
      "mae_dy": 0.0023222353775054216,
      "pose_mae_dtheta": 0.22774569690227509,
      "pose_mae_dx": 0.09264077991247177,
      "pose_mae_dy": 0.029061133041977882,
      "pose_rmse_dtheta": 0.4031047224998474,
      "pose_rmse_dx": 0.1914447396993637,
      "pose_rmse_dy": 0.08160602301359177,
      "pose_rmse_mean": 0.2253851741552353,
      "rmse_dtheta": 0.042607128620147705,
      "rmse_dx": 0.022872809320688248,
      "rmse_dy": 0.004625293426215649,
      "rmse_mean": 0.023368408903479576,
      "rotation_flip": 0.014836795628070831,
      "sparse_tokens": 6316.0,
      "step": 10033,
      "turn_loss": 0.23417288064956665,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.46617729046645606,
      "grad_norm": 0.598935604095459,
      "learning_rate": 6.613041609193332e-07,
      "loss": 0.1798,
      "mae_dtheta": 0.008114814758300781,
      "mae_dx": 0.0011418394278734922,
      "mae_dy": 0.001682243193499744,
      "pose_mae_dtheta": 0.05330800637602806,
      "pose_mae_dx": 0.01672917790710926,
      "pose_mae_dy": 0.018676897510886192,
      "pose_rmse_dtheta": 0.19537955522537231,
      "pose_rmse_dx": 0.04846397414803505,
      "pose_rmse_dy": 0.04611843824386597,
      "pose_rmse_mean": 0.09665399044752121,
      "rmse_dtheta": 0.022093025967478752,
      "rmse_dx": 0.003918460104614496,
      "rmse_dy": 0.004169382154941559,
      "rmse_mean": 0.01006028987467289,
      "rotation_flip": 0.0032817628234624863,
      "sparse_tokens": 32073.0,
      "step": 10034,
      "turn_loss": 0.0585814006626606,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.46622375023229884,
      "grad_norm": 0.34880876541137695,
      "learning_rate": 6.606471434697403e-07,
      "loss": 0.1026,
      "mae_dtheta": 0.035792022943496704,
      "mae_dx": 0.01668456569314003,
      "mae_dy": 0.005560142919421196,
      "pose_mae_dtheta": 0.27939078211784363,
      "pose_mae_dx": 0.1355457305908203,
      "pose_mae_dy": 0.06717681884765625,
      "pose_rmse_dtheta": 0.42804616689682007,
      "pose_rmse_dx": 0.28060460090637207,
      "pose_rmse_dy": 0.11648741364479065,
      "pose_rmse_mean": 0.27504608035087585,
      "rmse_dtheta": 0.04837245121598244,
      "rmse_dx": 0.029289485886693,
      "rmse_dy": 0.00959952175617218,
      "rmse_mean": 0.02908715419471264,
      "rotation_flip": 0.004081632476300001,
      "sparse_tokens": 4573.0,
      "step": 10035,
      "turn_loss": 0.34006166458129883,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.4662702099981416,
      "grad_norm": 0.35532480478286743,
      "learning_rate": 6.599904294734227e-07,
      "loss": 0.0802,
      "mae_dtheta": 0.02747993730008602,
      "mae_dx": 0.012029987759888172,
      "mae_dy": 0.003137991763651371,
      "pose_mae_dtheta": 0.195065438747406,
      "pose_mae_dx": 0.09807410091161728,
      "pose_mae_dy": 0.04071070998907089,
      "pose_rmse_dtheta": 0.3729717433452606,
      "pose_rmse_dx": 0.23630115389823914,
      "pose_rmse_dy": 0.10331446677446365,
      "pose_rmse_mean": 0.23752912878990173,
      "rmse_dtheta": 0.04524505138397217,
      "rmse_dx": 0.025545872747898102,
      "rmse_dy": 0.007763050030916929,
      "rmse_mean": 0.02618465945124626,
      "rotation_flip": 0.002610966097563505,
      "sparse_tokens": 17611.0,
      "step": 10036,
      "turn_loss": 0.17713899910449982,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4663166697639844,
      "grad_norm": 0.38444784283638,
      "learning_rate": 6.593340189763031e-07,
      "loss": 0.0886,
      "mae_dtheta": 0.0078198267146945,
      "mae_dx": 0.0014547227183356881,
      "mae_dy": 0.002068873029202223,
      "pose_mae_dtheta": 0.049301162362098694,
      "pose_mae_dx": 0.018988123163580894,
      "pose_mae_dy": 0.019777145236730576,
      "pose_rmse_dtheta": 0.14698892831802368,
      "pose_rmse_dx": 0.05622139945626259,
      "pose_rmse_dy": 0.04961145669221878,
      "pose_rmse_mean": 0.08427392691373825,
      "rmse_dtheta": 0.020336706191301346,
      "rmse_dx": 0.00387620204128325,
      "rmse_dy": 0.005543008912354708,
      "rmse_mean": 0.009918639436364174,
      "rotation_flip": 0.0038872691802680492,
      "sparse_tokens": 32105.0,
      "step": 10037,
      "turn_loss": 0.06633737683296204,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.46636312952982717,
      "grad_norm": 0.49555259943008423,
      "learning_rate": 6.586779120242859e-07,
      "loss": 0.1238,
      "mae_dtheta": 0.04108265042304993,
      "mae_dx": 0.0171271450817585,
      "mae_dy": 0.006588163319975138,
      "pose_mae_dtheta": 0.3267884850502014,
      "pose_mae_dx": 0.13042864203453064,
      "pose_mae_dy": 0.09593431651592255,
      "pose_rmse_dtheta": 0.5383457541465759,
      "pose_rmse_dx": 0.2606047987937927,
      "pose_rmse_dy": 0.20005188882350922,
      "pose_rmse_mean": 0.3330008387565613,
      "rmse_dtheta": 0.057875461876392365,
      "rmse_dx": 0.030820332467556,
      "rmse_dy": 0.011663621291518211,
      "rmse_mean": 0.033453140407800674,
      "rotation_flip": 0.015299026854336262,
      "sparse_tokens": 13406.0,
      "step": 10038,
      "turn_loss": 0.33182814717292786,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.46640958929566995,
      "grad_norm": 0.6958499550819397,
      "learning_rate": 6.580221086632516e-07,
      "loss": 0.1542,
      "mae_dtheta": 0.03502148389816284,
      "mae_dx": 0.009128374047577381,
      "mae_dy": 0.005802701693028212,
      "pose_mae_dtheta": 0.29172149300575256,
      "pose_mae_dx": 0.07835198193788528,
      "pose_mae_dy": 0.0727202445268631,
      "pose_rmse_dtheta": 0.5051659345626831,
      "pose_rmse_dx": 0.18946465849876404,
      "pose_rmse_dy": 0.178502157330513,
      "pose_rmse_mean": 0.2910442650318146,
      "rmse_dtheta": 0.05525410547852516,
      "rmse_dx": 0.02053481712937355,
      "rmse_dy": 0.015000936575233936,
      "rmse_mean": 0.03026328794658184,
      "rotation_flip": 0.008743169717490673,
      "sparse_tokens": 15471.0,
      "step": 10039,
      "turn_loss": 0.2588154077529907,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.4664560490615127,
      "grad_norm": 0.4007149040699005,
      "learning_rate": 6.573666089390629e-07,
      "loss": 0.0961,
      "mae_dtheta": 0.027164990082383156,
      "mae_dx": 0.011120119132101536,
      "mae_dy": 0.0012986932415515184,
      "pose_mae_dtheta": 0.20828983187675476,
      "pose_mae_dx": 0.0751737728714943,
      "pose_mae_dy": 0.022740723565220833,
      "pose_rmse_dtheta": 0.40240055322647095,
      "pose_rmse_dx": 0.19894306361675262,
      "pose_rmse_dy": 0.046195946633815765,
      "pose_rmse_mean": 0.21584652364253998,
      "rmse_dtheta": 0.04523135721683502,
      "rmse_dx": 0.024053024128079414,
      "rmse_dy": 0.002339996863156557,
      "rmse_mean": 0.023874793201684952,
      "rotation_flip": 0.0069444444961845875,
      "sparse_tokens": 2934.0,
      "step": 10040,
      "turn_loss": 0.19033031165599823,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.4665025088273555,
      "grad_norm": 0.5259307026863098,
      "learning_rate": 6.567114128975571e-07,
      "loss": 0.1277,
      "mae_dtheta": 0.031310513615608215,
      "mae_dx": 0.00989537313580513,
      "mae_dy": 0.006003616377711296,
      "pose_mae_dtheta": 0.22944819927215576,
      "pose_mae_dx": 0.07269246876239777,
      "pose_mae_dy": 0.07343311607837677,
      "pose_rmse_dtheta": 0.3964601457118988,
      "pose_rmse_dx": 0.15951116383075714,
      "pose_rmse_dy": 0.14674392342567444,
      "pose_rmse_mean": 0.2342384308576584,
      "rmse_dtheta": 0.04660651087760925,
      "rmse_dx": 0.020978068932890892,
      "rmse_dy": 0.010328867472708225,
      "rmse_mean": 0.025971150025725365,
      "rotation_flip": 0.010825439356267452,
      "sparse_tokens": 13019.0,
      "step": 10041,
      "turn_loss": 0.24973563849925995,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4665489685931983,
      "grad_norm": 0.6387810707092285,
      "learning_rate": 6.560565205845543e-07,
      "loss": 0.1548,
      "mae_dtheta": 0.007927296683192253,
      "mae_dx": 0.002184424316510558,
      "mae_dy": 0.0023088690359145403,
      "pose_mae_dtheta": 0.05499293655157089,
      "pose_mae_dx": 0.022097524255514145,
      "pose_mae_dy": 0.022147702053189278,
      "pose_rmse_dtheta": 0.14467857778072357,
      "pose_rmse_dx": 0.0657012015581131,
      "pose_rmse_dy": 0.06331942230463028,
      "pose_rmse_mean": 0.09123306721448898,
      "rmse_dtheta": 0.018616285175085068,
      "rmse_dx": 0.006904467940330505,
      "rmse_dy": 0.006155801471322775,
      "rmse_mean": 0.010558851063251495,
      "rotation_flip": 0.007285089697688818,
      "sparse_tokens": 32073.0,
      "step": 10042,
      "turn_loss": 0.08146730810403824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.46659542835904105,
      "grad_norm": 0.5451212525367737,
      "learning_rate": 6.554019320458494e-07,
      "loss": 0.1677,
      "mae_dtheta": 0.01235178206115961,
      "mae_dx": 0.0028842140454798937,
      "mae_dy": 0.0020023330580443144,
      "pose_mae_dtheta": 0.0850117951631546,
      "pose_mae_dx": 0.028979133814573288,
      "pose_mae_dy": 0.01936698704957962,
      "pose_rmse_dtheta": 0.2568313181400299,
      "pose_rmse_dx": 0.07326757907867432,
      "pose_rmse_dy": 0.05727829039096832,
      "pose_rmse_mean": 0.12912574410438538,
      "rmse_dtheta": 0.03210168704390526,
      "rmse_dx": 0.007949119433760643,
      "rmse_dy": 0.0060654026456177235,
      "rmse_mean": 0.015372069552540779,
      "rotation_flip": 0.00527325039729476,
      "sparse_tokens": 32185.0,
      "step": 10043,
      "turn_loss": 0.12215246260166168,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.46664188812488383,
      "grad_norm": 0.6021621227264404,
      "learning_rate": 6.547476473272202e-07,
      "loss": 0.1451,
      "mae_dtheta": 0.03370203822851181,
      "mae_dx": 0.014838676899671555,
      "mae_dy": 0.00831318087875843,
      "pose_mae_dtheta": 0.2117704600095749,
      "pose_mae_dx": 0.1320115625858307,
      "pose_mae_dy": 0.08717241138219833,
      "pose_rmse_dtheta": 0.3727739155292511,
      "pose_rmse_dx": 0.2488444447517395,
      "pose_rmse_dy": 0.16908365488052368,
      "pose_rmse_mean": 0.26356735825538635,
      "rmse_dtheta": 0.049249593168497086,
      "rmse_dx": 0.026660224422812462,
      "rmse_dy": 0.015966633334755898,
      "rmse_mean": 0.0306254830211401,
      "rotation_flip": 0.013245033100247383,
      "sparse_tokens": 4512.0,
      "step": 10044,
      "turn_loss": 0.35571932792663574,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.4666883478907266,
      "grad_norm": 0.38713833689689636,
      "learning_rate": 6.540936664744197e-07,
      "loss": 0.069,
      "mae_dtheta": 0.005993451923131943,
      "mae_dx": 0.0009636987815611064,
      "mae_dy": 0.00039740934153087437,
      "pose_mae_dtheta": 0.04252490773797035,
      "pose_mae_dx": 0.007129083387553692,
      "pose_mae_dy": 0.006289015524089336,
      "pose_rmse_dtheta": 0.19670389592647552,
      "pose_rmse_dx": 0.016318755224347115,
      "pose_rmse_dy": 0.018892385065555573,
      "pose_rmse_mean": 0.07730501145124435,
      "rmse_dtheta": 0.02405577339231968,
      "rmse_dx": 0.0029330854304134846,
      "rmse_dy": 0.0009562623454257846,
      "rmse_mean": 0.009315039962530136,
      "rotation_flip": 0.0015889829955995083,
      "sparse_tokens": 32201.0,
      "step": 10045,
      "turn_loss": 0.03743936866521835,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.4667348076565694,
      "grad_norm": 0.5756151676177979,
      "learning_rate": 6.534399895331822e-07,
      "loss": 0.1483,
      "mae_dtheta": 0.04704322665929794,
      "mae_dx": 0.007155471947044134,
      "mae_dy": 0.005779313389211893,
      "pose_mae_dtheta": 0.3515886068344116,
      "pose_mae_dx": 0.06203342601656914,
      "pose_mae_dy": 0.057740144431591034,
      "pose_rmse_dtheta": 0.565061092376709,
      "pose_rmse_dx": 0.16022731363773346,
      "pose_rmse_dy": 0.16232410073280334,
      "pose_rmse_mean": 0.295870840549469,
      "rmse_dtheta": 0.06641831248998642,
      "rmse_dx": 0.016475925222039223,
      "rmse_dy": 0.01489041093736887,
      "rmse_mean": 0.03259488195180893,
      "rotation_flip": 0.015584415756165981,
      "sparse_tokens": 11690.0,
      "step": 10046,
      "turn_loss": 0.38529172539711,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.4667812674224122,
      "grad_norm": 0.7285639047622681,
      "learning_rate": 6.527866165492186e-07,
      "loss": 0.1306,
      "mae_dtheta": 0.00712836068123579,
      "mae_dx": 0.002834102837368846,
      "mae_dy": 0.0008479184471070766,
      "pose_mae_dtheta": 0.05175578594207764,
      "pose_mae_dx": 0.020820653066039085,
      "pose_mae_dy": 0.009474430233240128,
      "pose_rmse_dtheta": 0.20232565701007843,
      "pose_rmse_dx": 0.04963422939181328,
      "pose_rmse_dy": 0.027624938637018204,
      "pose_rmse_mean": 0.09319494664669037,
      "rmse_dtheta": 0.023120731115341187,
      "rmse_dx": 0.007962594740092754,
      "rmse_dy": 0.0024034364614635706,
      "rmse_mean": 0.011162254959344864,
      "rotation_flip": 0.0021987687796354294,
      "sparse_tokens": 32233.0,
      "step": 10047,
      "turn_loss": 0.08084619045257568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.466827727188255,
      "grad_norm": 0.38815838098526,
      "learning_rate": 6.521335475682205e-07,
      "loss": 0.0763,
      "mae_dtheta": 0.00857495330274105,
      "mae_dx": 0.0017331239068880677,
      "mae_dy": 0.0007044223020784557,
      "pose_mae_dtheta": 0.0594119131565094,
      "pose_mae_dx": 0.013890866190195084,
      "pose_mae_dy": 0.009246784262359142,
      "pose_rmse_dtheta": 0.19255292415618896,
      "pose_rmse_dx": 0.03477061539888382,
      "pose_rmse_dy": 0.027722662314772606,
      "pose_rmse_mean": 0.08501540124416351,
      "rmse_dtheta": 0.026641204953193665,
      "rmse_dx": 0.004949003458023071,
      "rmse_dy": 0.0016315799439325929,
      "rmse_mean": 0.011073930189013481,
      "rotation_flip": 0.002160760574042797,
      "sparse_tokens": 32265.0,
      "step": 10048,
      "turn_loss": 0.061636798083782196,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.46687418695409777,
      "grad_norm": 0.5482453107833862,
      "learning_rate": 6.514807826358566e-07,
      "loss": 0.148,
      "mae_dtheta": 0.007198687642812729,
      "mae_dx": 0.0013478639302775264,
      "mae_dy": 0.001479940372519195,
      "pose_mae_dtheta": 0.05090797692537308,
      "pose_mae_dx": 0.01299972552806139,
      "pose_mae_dy": 0.01633465848863125,
      "pose_rmse_dtheta": 0.14617404341697693,
      "pose_rmse_dx": 0.03187449276447296,
      "pose_rmse_dy": 0.03919745236635208,
      "pose_rmse_mean": 0.07241533696651459,
      "rmse_dtheta": 0.018422016873955727,
      "rmse_dx": 0.0038833918515592813,
      "rmse_dy": 0.0038523292168974876,
      "rmse_mean": 0.00871924590319395,
      "rotation_flip": 0.002170138992369175,
      "sparse_tokens": 32153.0,
      "step": 10049,
      "turn_loss": 0.05554761365056038,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23294.0,
      "epoch": 0.46692064671994055,
      "grad_norm": 0.8735436797142029,
      "learning_rate": 6.508283217977768e-07,
      "loss": 0.2692,
      "mae_dtheta": 0.03313085436820984,
      "mae_dx": 0.015334514901041985,
      "mae_dy": 0.005062158219516277,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.8735435605049133,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 146.71749877929688,
      "model/head/act_norm_mean": 107.05702039930556,
      "model/head/act_norm_min": 62.586585998535156,
      "model/head/act_over_embed": 73.570586702019,
      "model/head/grad_frac": 0.11818206310272217,
      "model/head/grad_norm": 0.10323718190193176,
      "model/head/grad_zero_frac": 0.00012278417125344276,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6957329644097222,
      "model/head/update_ratio": 0.0017575350357219577,
      "model/head/weight_delta": 9.95069408416748,
      "model/head/weight_delta_rel": 0.1745646446943283,
      "model/head/weight_norm": 58.7397575378418,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4227544367313385,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227544367313385,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227544367313385,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29052080681117004,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09779158979654312,
      "model/modality_embedder.encoders.pose/grad_norm": 0.08542521297931671,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002758347662165761,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1482956409454346,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10286463052034378,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96970558166504,
      "model/modality_embedder/grad_frac": 0.09779158979654312,
      "model/modality_embedder/grad_norm": 0.08542521297931671,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.002758347662165761,
      "model/modality_embedder/weight_delta": 3.1482956409454346,
      "model/modality_embedder/weight_delta_rel": 0.10286463052034378,
      "model/modality_embedder/weight_norm": 30.96970558166504,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.29695892333984,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.339757633377424,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.256026268005371,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.039299955910614,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07224301248788834,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06310741603374481,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0022573224268853664,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.723670482635498,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09925219416618347,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.956758499145508,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 75.50960540771484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.11584408068783,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.727316856384277,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.57263382833812,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07436313480138779,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06495943665504456,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0021824759896844625,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.453442096710205,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11962993443012238,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.764102935791016,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 77.36990356445312,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.710613701499117,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.945985794067383,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.66857444222806,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06782440096139908,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.059247568249702454,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0019276784732937813,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.740405559539795,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1255958080291748,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.735191345214844,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 78.3636245727539,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.54563147597002,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.682144165039062,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.92961583655154,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06212090328335762,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05426531657576561,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0018118743319064379,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.213639497756958,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1098269447684288,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9498233795166,
      "model/normalizer/grad_frac": 0.24793016910552979,
      "model/normalizer/grad_norm": 0.21657779812812805,
      "model/normalizer/grad_zero_frac": 0.00017962424317374825,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0027536770794540644,
      "model/normalizer/weight_delta": 6.7615227699279785,
      "model/normalizer/weight_delta_rel": 0.08708450198173523,
      "model/normalizer/weight_norm": 78.65039825439453,
      "pose_mae_dtheta": 0.2601732611656189,
      "pose_mae_dx": 0.13857130706310272,
      "pose_mae_dy": 0.06685233861207962,
      "pose_rmse_dtheta": 0.4406179189682007,
      "pose_rmse_dx": 0.28513529896736145,
      "pose_rmse_dy": 0.16111183166503906,
      "pose_rmse_mean": 0.29562169313430786,
      "rmse_dtheta": 0.04932040721178055,
      "rmse_dx": 0.028759444132447243,
      "rmse_dy": 0.011817791499197483,
      "rmse_mean": 0.029965881258249283,
      "rotation_flip": 0.012345679104328156,
      "sparse_tokens": 19341.0,
      "step": 10050,
      "turn_loss": 0.34012889862060547,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4669671064857833,
      "grad_norm": 0.4570225775241852,
      "learning_rate": 6.501761650996052e-07,
      "loss": 0.0938,
      "mae_dtheta": 0.009089774452149868,
      "mae_dx": 0.001284590340219438,
      "mae_dy": 0.002076989971101284,
      "pose_mae_dtheta": 0.058596059679985046,
      "pose_mae_dx": 0.01837150752544403,
      "pose_mae_dy": 0.02257061004638672,
      "pose_rmse_dtheta": 0.1676117330789566,
      "pose_rmse_dx": 0.055434197187423706,
      "pose_rmse_dy": 0.054852891713380814,
      "pose_rmse_mean": 0.09263294190168381,
      "rmse_dtheta": 0.02114074118435383,
      "rmse_dx": 0.004047092515975237,
      "rmse_dy": 0.004643303342163563,
      "rmse_mean": 0.009943712502717972,
      "rotation_flip": 0.004258943721652031,
      "sparse_tokens": 32073.0,
      "step": 10051,
      "turn_loss": 0.06387337297201157,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.4670135662516261,
      "grad_norm": 0.5665558576583862,
      "learning_rate": 6.495243125869493e-07,
      "loss": 0.1201,
      "mae_dtheta": 0.023656371980905533,
      "mae_dx": 0.013071575202047825,
      "mae_dy": 0.005458974279463291,
      "pose_mae_dtheta": 0.18075354397296906,
      "pose_mae_dx": 0.11760565638542175,
      "pose_mae_dy": 0.08966296911239624,
      "pose_rmse_dtheta": 0.3576025664806366,
      "pose_rmse_dx": 0.26150164008140564,
      "pose_rmse_dy": 0.2412673383951187,
      "pose_rmse_mean": 0.28679051995277405,
      "rmse_dtheta": 0.0417952761054039,
      "rmse_dx": 0.027250343933701515,
      "rmse_dy": 0.01095540076494217,
      "rmse_mean": 0.026667006313800812,
      "rotation_flip": 0.011131725274026394,
      "sparse_tokens": 11802.0,
      "step": 10052,
      "turn_loss": 0.21954625844955444,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4670600260174689,
      "grad_norm": 0.3272106945514679,
      "learning_rate": 6.488727643053949e-07,
      "loss": 0.0583,
      "mae_dtheta": 0.008569043129682541,
      "mae_dx": 0.002197055611759424,
      "mae_dy": 0.0009223130764439702,
      "pose_mae_dtheta": 0.0632377341389656,
      "pose_mae_dx": 0.019447021186351776,
      "pose_mae_dy": 0.014707266353070736,
      "pose_rmse_dtheta": 0.19986267387866974,
      "pose_rmse_dx": 0.06028418615460396,
      "pose_rmse_dy": 0.045253559947013855,
      "pose_rmse_mean": 0.10180014371871948,
      "rmse_dtheta": 0.024261921644210815,
      "rmse_dx": 0.007511657662689686,
      "rmse_dy": 0.002558800857514143,
      "rmse_mean": 0.011444127187132835,
      "rotation_flip": 0.0043923864141106606,
      "sparse_tokens": 32105.0,
      "step": 10053,
      "turn_loss": 0.04951169341802597,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.46710648578331165,
      "grad_norm": 0.700428307056427,
      "learning_rate": 6.482215203005016e-07,
      "loss": 0.1735,
      "mae_dtheta": 0.046655163168907166,
      "mae_dx": 0.010702965781092644,
      "mae_dy": 0.006500672549009323,
      "pose_mae_dtheta": 0.3947814404964447,
      "pose_mae_dx": 0.1085958406329155,
      "pose_mae_dy": 0.08254870772361755,
      "pose_rmse_dtheta": 0.6151082515716553,
      "pose_rmse_dx": 0.22134028375148773,
      "pose_rmse_dy": 0.1701425462961197,
      "pose_rmse_mean": 0.3355303704738617,
      "rmse_dtheta": 0.06313581764698029,
      "rmse_dx": 0.022544894367456436,
      "rmse_dy": 0.011590403504669666,
      "rmse_mean": 0.032423704862594604,
      "rotation_flip": 0.014204545877873898,
      "sparse_tokens": 12039.0,
      "step": 10054,
      "turn_loss": 0.37883850932121277,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 27171.0,
      "epoch": 0.46715294554915443,
      "grad_norm": 0.40916627645492554,
      "learning_rate": 6.475705806178146e-07,
      "loss": 0.1106,
      "mae_dtheta": 0.03944173827767372,
      "mae_dx": 0.014149527996778488,
      "mae_dy": 0.005685889162123203,
      "pose_mae_dtheta": 0.30704689025878906,
      "pose_mae_dx": 0.10972443968057632,
      "pose_mae_dy": 0.06546403467655182,
      "pose_rmse_dtheta": 0.5252143144607544,
      "pose_rmse_dx": 0.219953253865242,
      "pose_rmse_dy": 0.14421352744102478,
      "pose_rmse_mean": 0.29646036028862,
      "rmse_dtheta": 0.058131325989961624,
      "rmse_dx": 0.02558082528412342,
      "rmse_dy": 0.012765689752995968,
      "rmse_mean": 0.03215928375720978,
      "rotation_flip": 0.01533494796603918,
      "sparse_tokens": 22780.0,
      "step": 10055,
      "turn_loss": 0.29607340693473816,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4671994053149972,
      "grad_norm": 0.6878544092178345,
      "learning_rate": 6.469199453028518e-07,
      "loss": 0.2153,
      "mae_dtheta": 0.012710277922451496,
      "mae_dx": 0.002638860372826457,
      "mae_dy": 0.004769418854266405,
      "pose_mae_dtheta": 0.0868045911192894,
      "pose_mae_dx": 0.03050660528242588,
      "pose_mae_dy": 0.037555623799562454,
      "pose_rmse_dtheta": 0.1722867488861084,
      "pose_rmse_dx": 0.06957793235778809,
      "pose_rmse_dy": 0.08389461040496826,
      "pose_rmse_mean": 0.10858643054962158,
      "rmse_dtheta": 0.02234835736453533,
      "rmse_dx": 0.005827562417834997,
      "rmse_dy": 0.009270255453884602,
      "rmse_mean": 0.012482058256864548,
      "rotation_flip": 0.00732113141566515,
      "sparse_tokens": 32073.0,
      "step": 10056,
      "turn_loss": 0.12880948185920715,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.46724586508084,
      "grad_norm": 0.6944468021392822,
      "learning_rate": 6.462696144011149e-07,
      "loss": 0.1145,
      "mae_dtheta": 0.030280640348792076,
      "mae_dx": 0.015208583325147629,
      "mae_dy": 0.0041793459095060825,
      "pose_mae_dtheta": 0.2435349076986313,
      "pose_mae_dx": 0.12260536849498749,
      "pose_mae_dy": 0.045019831508398056,
      "pose_rmse_dtheta": 0.4527992606163025,
      "pose_rmse_dx": 0.27963289618492126,
      "pose_rmse_dy": 0.10388242453336716,
      "pose_rmse_mean": 0.2787715196609497,
      "rmse_dtheta": 0.04960278049111366,
      "rmse_dx": 0.029389996081590652,
      "rmse_dy": 0.008114577271044254,
      "rmse_mean": 0.029035784304142,
      "rotation_flip": 0.0015174506697803736,
      "sparse_tokens": 12689.0,
      "step": 10057,
      "turn_loss": 0.28206250071525574,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.46729232484668276,
      "grad_norm": 0.3924673795700073,
      "learning_rate": 6.456195879580795e-07,
      "loss": 0.1218,
      "mae_dtheta": 0.0376383513212204,
      "mae_dx": 0.013053822331130505,
      "mae_dy": 0.008635253645479679,
      "pose_mae_dtheta": 0.3578357994556427,
      "pose_mae_dx": 0.10144002735614777,
      "pose_mae_dy": 0.04190240055322647,
      "pose_rmse_dtheta": 0.5550061464309692,
      "pose_rmse_dx": 0.20942693948745728,
      "pose_rmse_dy": 0.08903630077838898,
      "pose_rmse_mean": 0.28448981046676636,
      "rmse_dtheta": 0.05640823394060135,
      "rmse_dx": 0.02331661619246006,
      "rmse_dy": 0.02032802253961563,
      "rmse_mean": 0.03335095942020416,
      "rotation_flip": 0.008021390065550804,
      "sparse_tokens": 5451.0,
      "step": 10058,
      "turn_loss": 0.33190444111824036,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 35689.0,
      "epoch": 0.46733878461252554,
      "grad_norm": 0.423974871635437,
      "learning_rate": 6.449698660192033e-07,
      "loss": 0.1249,
      "mae_dtheta": 0.029250796884298325,
      "mae_dx": 0.010474229231476784,
      "mae_dy": 0.004976468626409769,
      "pose_mae_dtheta": 0.21290455758571625,
      "pose_mae_dx": 0.08645838499069214,
      "pose_mae_dy": 0.06596680730581284,
      "pose_rmse_dtheta": 0.38180866837501526,
      "pose_rmse_dx": 0.18454183638095856,
      "pose_rmse_dy": 0.154656782746315,
      "pose_rmse_mean": 0.24033576250076294,
      "rmse_dtheta": 0.04617152735590935,
      "rmse_dx": 0.021766791120171547,
      "rmse_dy": 0.010516895912587643,
      "rmse_mean": 0.026151739060878754,
      "rotation_flip": 0.017321016639471054,
      "sparse_tokens": 29689.0,
      "step": 10059,
      "turn_loss": 0.2470102608203888,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.4673852443783683,
      "grad_norm": 0.3569205403327942,
      "learning_rate": 6.443204486299231e-07,
      "loss": 0.0979,
      "mae_dtheta": 0.039151813834905624,
      "mae_dx": 0.011864707805216312,
      "mae_dy": 0.00865299254655838,
      "pose_mae_dtheta": 0.31528571248054504,
      "pose_mae_dx": 0.10178631544113159,
      "pose_mae_dy": 0.07381217181682587,
      "pose_rmse_dtheta": 0.594165027141571,
      "pose_rmse_dx": 0.2232806533575058,
      "pose_rmse_dy": 0.19686442613601685,
      "pose_rmse_mean": 0.33810338377952576,
      "rmse_dtheta": 0.061876486986875534,
      "rmse_dx": 0.023623239248991013,
      "rmse_dy": 0.01979367807507515,
      "rmse_mean": 0.03509780392050743,
      "rotation_flip": 0.00817438680678606,
      "sparse_tokens": 12750.0,
      "step": 10060,
      "turn_loss": 0.31459009647369385,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.4674317041442111,
      "grad_norm": 0.47392648458480835,
      "learning_rate": 6.436713358356506e-07,
      "loss": 0.1263,
      "mae_dtheta": 0.03582217916846275,
      "mae_dx": 0.010875134728848934,
      "mae_dy": 0.0040543945506215096,
      "pose_mae_dtheta": 0.30201297998428345,
      "pose_mae_dx": 0.0840337872505188,
      "pose_mae_dy": 0.055799130350351334,
      "pose_rmse_dtheta": 0.6028640866279602,
      "pose_rmse_dx": 0.20138457417488098,
      "pose_rmse_dy": 0.14605854451656342,
      "pose_rmse_mean": 0.3167690932750702,
      "rmse_dtheta": 0.05894751101732254,
      "rmse_dx": 0.02417091839015484,
      "rmse_dy": 0.008959468454122543,
      "rmse_mean": 0.030692633241415024,
      "rotation_flip": 0.008438818156719208,
      "sparse_tokens": 16861.0,
      "step": 10061,
      "turn_loss": 0.20335592329502106,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.46747816391005387,
      "grad_norm": 0.5980653762817383,
      "learning_rate": 6.430225276817808e-07,
      "loss": 0.1379,
      "mae_dtheta": 0.003995615057647228,
      "mae_dx": 0.0010428078239783645,
      "mae_dy": 0.0006435481482185423,
      "pose_mae_dtheta": 0.025369100272655487,
      "pose_mae_dx": 0.009003642946481705,
      "pose_mae_dy": 0.007773144170641899,
      "pose_rmse_dtheta": 0.09305395931005478,
      "pose_rmse_dx": 0.020335957407951355,
      "pose_rmse_dy": 0.018673062324523926,
      "pose_rmse_mean": 0.044020991772413254,
      "rmse_dtheta": 0.013527026399970055,
      "rmse_dx": 0.0031573413871228695,
      "rmse_dy": 0.0014455387135967612,
      "rmse_mean": 0.0060433028265833855,
      "rotation_flip": 0.0020366599783301353,
      "sparse_tokens": 32153.0,
      "step": 10062,
      "turn_loss": 0.03746054694056511,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.4675246236758967,
      "grad_norm": 0.3853095769882202,
      "learning_rate": 6.423740242136833e-07,
      "loss": 0.0843,
      "mae_dtheta": 0.036864493042230606,
      "mae_dx": 0.009669292718172073,
      "mae_dy": 0.004939164966344833,
      "pose_mae_dtheta": 0.31469473242759705,
      "pose_mae_dx": 0.0750160813331604,
      "pose_mae_dy": 0.06255261600017548,
      "pose_rmse_dtheta": 0.5580113530158997,
      "pose_rmse_dx": 0.18306109309196472,
      "pose_rmse_dy": 0.15165793895721436,
      "pose_rmse_mean": 0.29757678508758545,
      "rmse_dtheta": 0.05727917701005936,
      "rmse_dx": 0.0221298448741436,
      "rmse_dy": 0.009179550223052502,
      "rmse_mean": 0.029529523104429245,
      "rotation_flip": 0.006147541105747223,
      "sparse_tokens": 8145.0,
      "step": 10063,
      "turn_loss": 0.25006163120269775,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4675710834417395,
      "grad_norm": 0.4796749949455261,
      "learning_rate": 6.417258254767095e-07,
      "loss": 0.0987,
      "mae_dtheta": 0.014143475331366062,
      "mae_dx": 0.002845821902155876,
      "mae_dy": 0.004157526418566704,
      "pose_mae_dtheta": 0.09426197409629822,
      "pose_mae_dx": 0.03354863449931145,
      "pose_mae_dy": 0.037814222276210785,
      "pose_rmse_dtheta": 0.18780668079853058,
      "pose_rmse_dx": 0.08478568494319916,
      "pose_rmse_dy": 0.07998254895210266,
      "pose_rmse_mean": 0.11752497404813766,
      "rmse_dtheta": 0.026259802281856537,
      "rmse_dx": 0.008604096248745918,
      "rmse_dy": 0.008649483323097229,
      "rmse_mean": 0.014504460617899895,
      "rotation_flip": 0.002655161079019308,
      "sparse_tokens": 32057.0,
      "step": 10064,
      "turn_loss": 0.12672431766986847,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.46761754320758225,
      "grad_norm": 0.6465522050857544,
      "learning_rate": 6.410779315161885e-07,
      "loss": 0.1192,
      "mae_dtheta": 0.00977953989058733,
      "mae_dx": 0.0019471300765872002,
      "mae_dy": 0.0020077850203961134,
      "pose_mae_dtheta": 0.06365588307380676,
      "pose_mae_dx": 0.02330792509019375,
      "pose_mae_dy": 0.021566597744822502,
      "pose_rmse_dtheta": 0.17202189564704895,
      "pose_rmse_dx": 0.07885531336069107,
      "pose_rmse_dy": 0.04980838671326637,
      "pose_rmse_mean": 0.10022853314876556,
      "rmse_dtheta": 0.023937344551086426,
      "rmse_dx": 0.0067077511921525,
      "rmse_dy": 0.0051878890953958035,
      "rmse_mean": 0.011944327503442764,
      "rotation_flip": 0.004379562102258205,
      "sparse_tokens": 32041.0,
      "step": 10065,
      "turn_loss": 0.08649523556232452,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.46766400297342503,
      "grad_norm": 0.6169832348823547,
      "learning_rate": 6.404303423774261e-07,
      "loss": 0.1531,
      "mae_dtheta": 0.03919321298599243,
      "mae_dx": 0.00782465748488903,
      "mae_dy": 0.00540646817535162,
      "pose_mae_dtheta": 0.31598547101020813,
      "pose_mae_dx": 0.053660210222005844,
      "pose_mae_dy": 0.06069386377930641,
      "pose_rmse_dtheta": 0.5773649215698242,
      "pose_rmse_dx": 0.1304198056459427,
      "pose_rmse_dy": 0.19531568884849548,
      "pose_rmse_mean": 0.30103346705436707,
      "rmse_dtheta": 0.06091422587633133,
      "rmse_dx": 0.01733393408358097,
      "rmse_dy": 0.013980837538838387,
      "rmse_mean": 0.03074299916625023,
      "rotation_flip": 0.012765957042574883,
      "sparse_tokens": 12552.0,
      "step": 10066,
      "turn_loss": 0.2953988015651703,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 32114.0,
      "epoch": 0.4677104627392678,
      "grad_norm": 0.5318294763565063,
      "learning_rate": 6.397830581057113e-07,
      "loss": 0.1605,
      "mae_dtheta": 0.02620600163936615,
      "mae_dx": 0.008060665801167488,
      "mae_dy": 0.00521902646869421,
      "pose_mae_dtheta": 0.18604834377765656,
      "pose_mae_dx": 0.07010599970817566,
      "pose_mae_dy": 0.06229909509420395,
      "pose_rmse_dtheta": 0.36253681778907776,
      "pose_rmse_dx": 0.16551262140274048,
      "pose_rmse_dy": 0.14568299055099487,
      "pose_rmse_mean": 0.22457748651504517,
      "rmse_dtheta": 0.0438811331987381,
      "rmse_dx": 0.019332634285092354,
      "rmse_dy": 0.010615725070238113,
      "rmse_mean": 0.024609830230474472,
      "rotation_flip": 0.011699930764734745,
      "sparse_tokens": 25374.0,
      "step": 10067,
      "turn_loss": 0.20798255503177643,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4677569225051106,
      "grad_norm": 0.606765627861023,
      "learning_rate": 6.391360787463064e-07,
      "loss": 0.1136,
      "mae_dtheta": 0.010503332130610943,
      "mae_dx": 0.0020930832251906395,
      "mae_dy": 0.002438774099573493,
      "pose_mae_dtheta": 0.06686054170131683,
      "pose_mae_dx": 0.020695887506008148,
      "pose_mae_dy": 0.025521859526634216,
      "pose_rmse_dtheta": 0.1631586253643036,
      "pose_rmse_dx": 0.05539441853761673,
      "pose_rmse_dy": 0.05425071716308594,
      "pose_rmse_mean": 0.09093458950519562,
      "rmse_dtheta": 0.02251456305384636,
      "rmse_dx": 0.006629155948758125,
      "rmse_dy": 0.0053510889410972595,
      "rmse_mean": 0.01149827055633068,
      "rotation_flip": 0.006284367758780718,
      "sparse_tokens": 32105.0,
      "step": 10068,
      "turn_loss": 0.08754177391529083,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.46780338227095336,
      "grad_norm": 0.5739712119102478,
      "learning_rate": 6.384894043444568e-07,
      "loss": 0.1604,
      "mae_dtheta": 0.01921497844159603,
      "mae_dx": 0.015258685685694218,
      "mae_dy": 0.006067606154829264,
      "pose_mae_dtheta": 0.1435563713312149,
      "pose_mae_dx": 0.12540096044540405,
      "pose_mae_dy": 0.06422627717256546,
      "pose_rmse_dtheta": 0.2526349425315857,
      "pose_rmse_dx": 0.2801154553890228,
      "pose_rmse_dy": 0.1457791030406952,
      "pose_rmse_mean": 0.22617650032043457,
      "rmse_dtheta": 0.0333014577627182,
      "rmse_dx": 0.029880724847316742,
      "rmse_dy": 0.012586870230734348,
      "rmse_mean": 0.02525635063648224,
      "rotation_flip": 0.011428571306169033,
      "sparse_tokens": 3789.0,
      "step": 10069,
      "turn_loss": 0.28236210346221924,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.46784984203679614,
      "grad_norm": 0.4915357828140259,
      "learning_rate": 6.378430349453834e-07,
      "loss": 0.1026,
      "mae_dtheta": 0.025812767446041107,
      "mae_dx": 0.009476360864937305,
      "mae_dy": 0.0028903125785291195,
      "pose_mae_dtheta": 0.20721940696239471,
      "pose_mae_dx": 0.05409363657236099,
      "pose_mae_dy": 0.03752555325627327,
      "pose_rmse_dtheta": 0.4324033260345459,
      "pose_rmse_dx": 0.15278460085391998,
      "pose_rmse_dy": 0.10874895751476288,
      "pose_rmse_mean": 0.23131230473518372,
      "rmse_dtheta": 0.04508156701922417,
      "rmse_dx": 0.022212054580450058,
      "rmse_dy": 0.007750494871288538,
      "rmse_mean": 0.025014705955982208,
      "rotation_flip": 0.020114943385124207,
      "sparse_tokens": 9148.0,
      "step": 10070,
      "turn_loss": 0.1456923931837082,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.4678963018026389,
      "grad_norm": 0.8467938899993896,
      "learning_rate": 6.371969705942877e-07,
      "loss": 0.187,
      "mae_dtheta": 0.031893182545900345,
      "mae_dx": 0.01242786180227995,
      "mae_dy": 0.00502597913146019,
      "pose_mae_dtheta": 0.26068076491355896,
      "pose_mae_dx": 0.10794920474290848,
      "pose_mae_dy": 0.07695841044187546,
      "pose_rmse_dtheta": 0.4720689654350281,
      "pose_rmse_dx": 0.238904669880867,
      "pose_rmse_dy": 0.16856859624385834,
      "pose_rmse_mean": 0.29318076372146606,
      "rmse_dtheta": 0.04965504631400108,
      "rmse_dx": 0.02593201957643032,
      "rmse_dy": 0.008805066347122192,
      "rmse_mean": 0.028130710124969482,
      "rotation_flip": 0.012345679104328156,
      "sparse_tokens": 18378.0,
      "step": 10071,
      "turn_loss": 0.23208563029766083,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4679427615684817,
      "grad_norm": 0.37589317560195923,
      "learning_rate": 6.365512113363509e-07,
      "loss": 0.1,
      "mae_dtheta": 0.009721706621348858,
      "mae_dx": 0.0018865218153223395,
      "mae_dy": 0.003585401689633727,
      "pose_mae_dtheta": 0.06154155731201172,
      "pose_mae_dx": 0.02635538950562477,
      "pose_mae_dy": 0.03382618725299835,
      "pose_rmse_dtheta": 0.129352405667305,
      "pose_rmse_dx": 0.06292669475078583,
      "pose_rmse_dy": 0.0727834552526474,
      "pose_rmse_mean": 0.08835419267416,
      "rmse_dtheta": 0.019760897383093834,
      "rmse_dx": 0.0048208413645625114,
      "rmse_dy": 0.007466302718967199,
      "rmse_mean": 0.01068267971277237,
      "rotation_flip": 0.0014684287598356605,
      "sparse_tokens": 32105.0,
      "step": 10072,
      "turn_loss": 0.09520959109067917,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.46798922133432447,
      "grad_norm": 0.5662034749984741,
      "learning_rate": 6.359057572167288e-07,
      "loss": 0.1351,
      "mae_dtheta": 0.008063902147114277,
      "mae_dx": 0.0013934477465227246,
      "mae_dy": 0.001317702466621995,
      "pose_mae_dtheta": 0.056979432702064514,
      "pose_mae_dx": 0.013055963441729546,
      "pose_mae_dy": 0.015651412308216095,
      "pose_rmse_dtheta": 0.18287858366966248,
      "pose_rmse_dx": 0.028965601697564125,
      "pose_rmse_dy": 0.04001811146736145,
      "pose_rmse_mean": 0.0839540958404541,
      "rmse_dtheta": 0.022229334339499474,
      "rmse_dx": 0.0038426825776696205,
      "rmse_dy": 0.003233561059460044,
      "rmse_mean": 0.009768527001142502,
      "rotation_flip": 0.003241491038352251,
      "sparse_tokens": 32217.0,
      "step": 10073,
      "turn_loss": 0.06384161114692688,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.46803568110016724,
      "grad_norm": 0.5234522819519043,
      "learning_rate": 6.352606082805601e-07,
      "loss": 0.1024,
      "mae_dtheta": 0.00920979492366314,
      "mae_dx": 0.0013268074253574014,
      "mae_dy": 0.0021932385861873627,
      "pose_mae_dtheta": 0.05959327518939972,
      "pose_mae_dx": 0.019473040476441383,
      "pose_mae_dy": 0.027873264625668526,
      "pose_rmse_dtheta": 0.11444175243377686,
      "pose_rmse_dx": 0.052874356508255005,
      "pose_rmse_dy": 0.05935021489858627,
      "pose_rmse_mean": 0.07555544376373291,
      "rmse_dtheta": 0.01757223531603813,
      "rmse_dx": 0.00411925558000803,
      "rmse_dy": 0.005143549293279648,
      "rmse_mean": 0.008945013396441936,
      "rotation_flip": 0.004219409078359604,
      "sparse_tokens": 32105.0,
      "step": 10074,
      "turn_loss": 0.07024169713258743,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.46808214086601,
      "grad_norm": 0.5542029738426208,
      "learning_rate": 6.34615764572959e-07,
      "loss": 0.083,
      "mae_dtheta": 0.00833728164434433,
      "mae_dx": 0.0016326846089214087,
      "mae_dy": 0.0021331508178263903,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5542029738426208,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.40382385253906,
      "model/head/act_norm_mean": 109.98194839015152,
      "model/head/act_norm_min": 57.86163330078125,
      "model/head/act_over_embed": 75.58062460093562,
      "model/head/grad_frac": 0.07536250352859497,
      "model/head/grad_norm": 0.04176612198352814,
      "model/head/grad_zero_frac": 0.0001494349999120459,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7054480350378788,
      "model/head/update_ratio": 0.0007110343431122601,
      "model/head/weight_delta": 9.951959609985352,
      "model/head/weight_delta_rel": 0.17458684742450714,
      "model/head/weight_norm": 58.739952087402344,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228241741657257,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42275163438585067,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42267680168151855,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29051888101311485,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09370272606611252,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05193033069372177,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5401822916666666,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016768114874139428,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1486330032348633,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10287565737962723,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969688415527344,
      "model/modality_embedder/grad_frac": 0.09370272606611252,
      "model/modality_embedder/grad_norm": 0.05193033069372177,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5401822916666666,
      "model/modality_embedder/update_ratio": 0.0016768114874139428,
      "model/modality_embedder/weight_delta": 3.1486330032348633,
      "model/modality_embedder/weight_delta_rel": 0.10287565737962723,
      "model/modality_embedder/weight_norm": 30.969688415527344,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.97959899902344,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.68911586099086,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.112106323242188,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.279382200669826,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.04144606366753578,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.022969532757997513,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008216035785153508,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7243285179138184,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09927617758512497,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.956953048706055,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 94.77822875976562,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.70617384159051,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.321632385253906,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.97831396678474,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.04302338883280754,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.023843690752983093,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008010818273760378,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4544296264648438,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11966414004564285,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76436424255371,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 96.4020004272461,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.56079896184063,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.461403846740723,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.25282971269456,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.043730612844228745,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.024235635995864868,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007885213708505034,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7415146827697754,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12563306093215942,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.73554801940918,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 97.14921569824219,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.30240149510983,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.02917766571045,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.44967527869696,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.044027093797922134,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02439994551241398,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008146913605742157,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2145519256591797,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10985813289880753,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.949926376342773,
      "model/normalizer/grad_frac": 0.1597721129655838,
      "model/normalizer/grad_norm": 0.08854617923498154,
      "model/normalizer/grad_zero_frac": 0.00021507639030460268,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0011258161393925548,
      "model/normalizer/weight_delta": 6.763423442840576,
      "model/normalizer/weight_delta_rel": 0.08710897713899612,
      "model/normalizer/weight_norm": 78.6506576538086,
      "pose_mae_dtheta": 0.056318096816539764,
      "pose_mae_dx": 0.020529067143797874,
      "pose_mae_dy": 0.023122964426875114,
      "pose_rmse_dtheta": 0.14428436756134033,
      "pose_rmse_dx": 0.05198487639427185,
      "pose_rmse_dy": 0.05673917010426521,
      "pose_rmse_mean": 0.08433614671230316,
      "rmse_dtheta": 0.018718106672167778,
      "rmse_dx": 0.00463603250682354,
      "rmse_dy": 0.0054257893934845924,
      "rmse_mean": 0.009593309834599495,
      "rotation_flip": 0.007554672192782164,
      "sparse_tokens": 32121.0,
      "step": 10075,
      "turn_loss": 0.07107862830162048,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.4681286006318528,
      "grad_norm": 0.5400146842002869,
      "learning_rate": 6.339712261390213e-07,
      "loss": 0.1081,
      "mae_dtheta": 0.03747014328837395,
      "mae_dx": 0.015412616543471813,
      "mae_dy": 0.004261121619492769,
      "pose_mae_dtheta": 0.30298563838005066,
      "pose_mae_dx": 0.11638468503952026,
      "pose_mae_dy": 0.05284959450364113,
      "pose_rmse_dtheta": 0.4800947606563568,
      "pose_rmse_dx": 0.24294184148311615,
      "pose_rmse_dy": 0.11883863806724548,
      "pose_rmse_mean": 0.2806250751018524,
      "rmse_dtheta": 0.05412919446825981,
      "rmse_dx": 0.028480667620897293,
      "rmse_dy": 0.008961047045886517,
      "rmse_mean": 0.0305236354470253,
      "rotation_flip": 0.009345794096589088,
      "sparse_tokens": 9304.0,
      "step": 10076,
      "turn_loss": 0.30879244208335876,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.4681750603976956,
      "grad_norm": 0.5155690312385559,
      "learning_rate": 6.333269930238184e-07,
      "loss": 0.1263,
      "mae_dtheta": 0.03192390128970146,
      "mae_dx": 0.01196457538753748,
      "mae_dy": 0.007094527129083872,
      "pose_mae_dtheta": 0.25784775614738464,
      "pose_mae_dx": 0.09412500262260437,
      "pose_mae_dy": 0.08908090740442276,
      "pose_rmse_dtheta": 0.4202802777290344,
      "pose_rmse_dx": 0.19141937792301178,
      "pose_rmse_dy": 0.20177510380744934,
      "pose_rmse_mean": 0.27115827798843384,
      "rmse_dtheta": 0.04675155505537987,
      "rmse_dx": 0.02411768026649952,
      "rmse_dy": 0.012107333168387413,
      "rmse_mean": 0.0276588574051857,
      "rotation_flip": 0.014388489536941051,
      "sparse_tokens": 13205.0,
      "step": 10077,
      "turn_loss": 0.2618677020072937,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 19155.0,
      "epoch": 0.46822152016353835,
      "grad_norm": 0.40075454115867615,
      "learning_rate": 6.326830652724037e-07,
      "loss": 0.1022,
      "mae_dtheta": 0.029557060450315475,
      "mae_dx": 0.008669152855873108,
      "mae_dy": 0.005171812139451504,
      "pose_mae_dtheta": 0.2146323025226593,
      "pose_mae_dx": 0.060213878750801086,
      "pose_mae_dy": 0.05309649556875229,
      "pose_rmse_dtheta": 0.40913450717926025,
      "pose_rmse_dx": 0.15242135524749756,
      "pose_rmse_dy": 0.12243042141199112,
      "pose_rmse_mean": 0.22799544036388397,
      "rmse_dtheta": 0.04837352782487869,
      "rmse_dx": 0.02025594562292099,
      "rmse_dy": 0.01027083769440651,
      "rmse_mean": 0.026300102472305298,
      "rotation_flip": 0.0070588234812021255,
      "sparse_tokens": 15804.0,
      "step": 10078,
      "turn_loss": 0.19721871614456177,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.46826797992938113,
      "grad_norm": 0.3826442360877991,
      "learning_rate": 6.320394429298054e-07,
      "loss": 0.0966,
      "mae_dtheta": 0.010849100537598133,
      "mae_dx": 0.0015440525021404028,
      "mae_dy": 0.0022958635818213224,
      "pose_mae_dtheta": 0.0729270875453949,
      "pose_mae_dx": 0.020085027441382408,
      "pose_mae_dy": 0.024958370253443718,
      "pose_rmse_dtheta": 0.1989346593618393,
      "pose_rmse_dx": 0.050673194229602814,
      "pose_rmse_dy": 0.05885843560099602,
      "pose_rmse_mean": 0.10282209515571594,
      "rmse_dtheta": 0.02427615039050579,
      "rmse_dx": 0.0040373289957642555,
      "rmse_dy": 0.005001717247068882,
      "rmse_mean": 0.011105066165328026,
      "rotation_flip": 0.0030052592046558857,
      "sparse_tokens": 32137.0,
      "step": 10079,
      "turn_loss": 0.08356547355651855,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.46831443969522396,
      "grad_norm": 0.8512680530548096,
      "learning_rate": 6.313961260410339e-07,
      "loss": 0.1656,
      "mae_dtheta": 0.014771945774555206,
      "mae_dx": 0.002413943177089095,
      "mae_dy": 0.0033427306916564703,
      "pose_mae_dtheta": 0.09401502460241318,
      "pose_mae_dx": 0.026366928592324257,
      "pose_mae_dy": 0.03503943234682083,
      "pose_rmse_dtheta": 0.20895643532276154,
      "pose_rmse_dx": 0.06510747969150543,
      "pose_rmse_dy": 0.07120150327682495,
      "pose_rmse_mean": 0.11508847773075104,
      "rmse_dtheta": 0.02781715989112854,
      "rmse_dx": 0.007273196242749691,
      "rmse_dy": 0.007019912824034691,
      "rmse_mean": 0.014036757871508598,
      "rotation_flip": 0.00516246585175395,
      "sparse_tokens": 32153.0,
      "step": 10080,
      "turn_loss": 0.11433673650026321,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.46836089946106674,
      "grad_norm": 0.5992921590805054,
      "learning_rate": 6.307531146510754e-07,
      "loss": 0.0967,
      "mae_dtheta": 0.012822995893657207,
      "mae_dx": 0.0031142649240791798,
      "mae_dy": 0.0032383573707193136,
      "pose_mae_dtheta": 0.08561629056930542,
      "pose_mae_dx": 0.03671572357416153,
      "pose_mae_dy": 0.03320466727018356,
      "pose_rmse_dtheta": 0.223799467086792,
      "pose_rmse_dx": 0.13125604391098022,
      "pose_rmse_dy": 0.08221402764320374,
      "pose_rmse_mean": 0.14575651288032532,
      "rmse_dtheta": 0.028177699074149132,
      "rmse_dx": 0.011823086999356747,
      "rmse_dy": 0.008041727356612682,
      "rmse_mean": 0.01601417176425457,
      "rotation_flip": 0.003418803447857499,
      "sparse_tokens": 32105.0,
      "step": 10081,
      "turn_loss": 0.12209105491638184,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4684073592269095,
      "grad_norm": 0.31697583198547363,
      "learning_rate": 6.301104088048976e-07,
      "loss": 0.0855,
      "mae_dtheta": 0.008695563301444054,
      "mae_dx": 0.0015012044459581375,
      "mae_dy": 0.001850448315963149,
      "pose_mae_dtheta": 0.06428968906402588,
      "pose_mae_dx": 0.016488779336214066,
      "pose_mae_dy": 0.021015632897615433,
      "pose_rmse_dtheta": 0.1895231306552887,
      "pose_rmse_dx": 0.051085323095321655,
      "pose_rmse_dy": 0.06324880570173264,
      "pose_rmse_mean": 0.10128575563430786,
      "rmse_dtheta": 0.02230074070394039,
      "rmse_dx": 0.005069822072982788,
      "rmse_dy": 0.004696195479482412,
      "rmse_mean": 0.010688919574022293,
      "rotation_flip": 0.003771551651880145,
      "sparse_tokens": 32073.0,
      "step": 10082,
      "turn_loss": 0.058442145586013794,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4684538189927523,
      "grad_norm": 0.30716338753700256,
      "learning_rate": 6.294680085474431e-07,
      "loss": 0.0739,
      "mae_dtheta": 0.008928507566452026,
      "mae_dx": 0.0013961081858724356,
      "mae_dy": 0.0021442610304802656,
      "pose_mae_dtheta": 0.05544300377368927,
      "pose_mae_dx": 0.0183408185839653,
      "pose_mae_dy": 0.02252618595957756,
      "pose_rmse_dtheta": 0.14521664381027222,
      "pose_rmse_dx": 0.04441992565989494,
      "pose_rmse_dy": 0.05046117678284645,
      "pose_rmse_mean": 0.0800325870513916,
      "rmse_dtheta": 0.020691772922873497,
      "rmse_dx": 0.003995000850409269,
      "rmse_dy": 0.004507630597800016,
      "rmse_mean": 0.009731468744575977,
      "rotation_flip": 0.006071428768336773,
      "sparse_tokens": 32121.0,
      "step": 10083,
      "turn_loss": 0.0770125612616539,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.46850027875859507,
      "grad_norm": 0.5305602550506592,
      "learning_rate": 6.28825913923638e-07,
      "loss": 0.1299,
      "mae_dtheta": 0.009499837644398212,
      "mae_dx": 0.002229345729574561,
      "mae_dy": 0.003397770691663027,
      "pose_mae_dtheta": 0.05880686640739441,
      "pose_mae_dx": 0.03103741817176342,
      "pose_mae_dy": 0.030021218582987785,
      "pose_rmse_dtheta": 0.11442384123802185,
      "pose_rmse_dx": 0.09182587265968323,
      "pose_rmse_dy": 0.06711817532777786,
      "pose_rmse_mean": 0.09112262725830078,
      "rmse_dtheta": 0.01903308928012848,
      "rmse_dx": 0.006135649047791958,
      "rmse_dy": 0.007948441430926323,
      "rmse_mean": 0.011039061471819878,
      "rotation_flip": 0.006961364299058914,
      "sparse_tokens": 32089.0,
      "step": 10084,
      "turn_loss": 0.09671669453382492,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.46854673852443784,
      "grad_norm": 0.37074539065361023,
      "learning_rate": 6.281841249783816e-07,
      "loss": 0.0984,
      "mae_dtheta": 0.025820592418313026,
      "mae_dx": 0.007950062863528728,
      "mae_dy": 0.0043069105595350266,
      "pose_mae_dtheta": 0.20663729310035706,
      "pose_mae_dx": 0.06038505584001541,
      "pose_mae_dy": 0.05756363645195961,
      "pose_rmse_dtheta": 0.401624470949173,
      "pose_rmse_dx": 0.15241201221942902,
      "pose_rmse_dy": 0.13515296578407288,
      "pose_rmse_mean": 0.2297298163175583,
      "rmse_dtheta": 0.04396923631429672,
      "rmse_dx": 0.01829509250819683,
      "rmse_dy": 0.008120406419038773,
      "rmse_mean": 0.023461580276489258,
      "rotation_flip": 0.007621951401233673,
      "sparse_tokens": 12826.0,
      "step": 10085,
      "turn_loss": 0.16287709772586823,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4685931982902806,
      "grad_norm": 0.4553506672382355,
      "learning_rate": 6.275426417565572e-07,
      "loss": 0.1076,
      "mae_dtheta": 0.008571911603212357,
      "mae_dx": 0.0016163114923983812,
      "mae_dy": 0.001770779024809599,
      "pose_mae_dtheta": 0.05574793368577957,
      "pose_mae_dx": 0.018323294818401337,
      "pose_mae_dy": 0.018350938335061073,
      "pose_rmse_dtheta": 0.1741584986448288,
      "pose_rmse_dx": 0.04342750832438469,
      "pose_rmse_dy": 0.040286142379045486,
      "pose_rmse_mean": 0.08595739305019379,
      "rmse_dtheta": 0.020274648442864418,
      "rmse_dx": 0.004634162876754999,
      "rmse_dy": 0.0036455614026635885,
      "rmse_mean": 0.009518124163150787,
      "rotation_flip": 0.004296455532312393,
      "sparse_tokens": 32153.0,
      "step": 10086,
      "turn_loss": 0.07107221335172653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4686396580561234,
      "grad_norm": 0.4181005358695984,
      "learning_rate": 6.269014643030214e-07,
      "loss": 0.1082,
      "mae_dtheta": 0.009276434779167175,
      "mae_dx": 0.0016157246427610517,
      "mae_dy": 0.002138964831829071,
      "pose_mae_dtheta": 0.06145060807466507,
      "pose_mae_dx": 0.016814595088362694,
      "pose_mae_dy": 0.023575102910399437,
      "pose_rmse_dtheta": 0.14538437128067017,
      "pose_rmse_dx": 0.03974214196205139,
      "pose_rmse_dy": 0.05699163302779198,
      "pose_rmse_mean": 0.08070605248212814,
      "rmse_dtheta": 0.020864296704530716,
      "rmse_dx": 0.005399192683398724,
      "rmse_dy": 0.005073261447250843,
      "rmse_mean": 0.01044558361172676,
      "rotation_flip": 0.003670336911454797,
      "sparse_tokens": 32153.0,
      "step": 10087,
      "turn_loss": 0.07635291665792465,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 42838.0,
      "epoch": 0.4686861178219662,
      "grad_norm": 0.37591424584388733,
      "learning_rate": 6.262605926626147e-07,
      "loss": 0.0949,
      "mae_dtheta": 0.028432630002498627,
      "mae_dx": 0.011021622456610203,
      "mae_dy": 0.00494253309443593,
      "pose_mae_dtheta": 0.21310295164585114,
      "pose_mae_dx": 0.09535259753465652,
      "pose_mae_dy": 0.04507134482264519,
      "pose_rmse_dtheta": 0.413133829832077,
      "pose_rmse_dx": 0.2326204627752304,
      "pose_rmse_dy": 0.11371008306741714,
      "pose_rmse_mean": 0.25315481424331665,
      "rmse_dtheta": 0.04720465838909149,
      "rmse_dx": 0.02388371154665947,
      "rmse_dy": 0.010728726163506508,
      "rmse_mean": 0.027272365987300873,
      "rotation_flip": 0.010173548944294453,
      "sparse_tokens": 30238.0,
      "step": 10088,
      "turn_loss": 0.21678121387958527,
      "turns": 132.0,
      "turns_per_sample": 132.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.46873257758780895,
      "grad_norm": 0.5323274731636047,
      "learning_rate": 6.25620026880151e-07,
      "loss": 0.1216,
      "mae_dtheta": 0.013409575447440147,
      "mae_dx": 0.0017513271886855364,
      "mae_dy": 0.003522965358570218,
      "pose_mae_dtheta": 0.08815091103315353,
      "pose_mae_dx": 0.027986500412225723,
      "pose_mae_dy": 0.03866635635495186,
      "pose_rmse_dtheta": 0.20085309445858002,
      "pose_rmse_dx": 0.07317961752414703,
      "pose_rmse_dy": 0.11329491436481476,
      "pose_rmse_mean": 0.1291092038154602,
      "rmse_dtheta": 0.026188846677541733,
      "rmse_dx": 0.004441054072231054,
      "rmse_dy": 0.007771342061460018,
      "rmse_mean": 0.012800414115190506,
      "rotation_flip": 0.0030060119461268187,
      "sparse_tokens": 32089.0,
      "step": 10089,
      "turn_loss": 0.11353955417871475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.46877903735365173,
      "grad_norm": 0.813713550567627,
      "learning_rate": 6.249797670004265e-07,
      "loss": 0.1861,
      "mae_dtheta": 0.036756910383701324,
      "mae_dx": 0.00883555319160223,
      "mae_dy": 0.0036745714023709297,
      "pose_mae_dtheta": 0.2675904631614685,
      "pose_mae_dx": 0.05074755847454071,
      "pose_mae_dy": 0.027480173856019974,
      "pose_rmse_dtheta": 0.5775474309921265,
      "pose_rmse_dx": 0.12568789720535278,
      "pose_rmse_dy": 0.07942739129066467,
      "pose_rmse_mean": 0.26088759303092957,
      "rmse_dtheta": 0.06131981685757637,
      "rmse_dx": 0.019257713109254837,
      "rmse_dy": 0.007780383341014385,
      "rmse_mean": 0.02945263683795929,
      "rotation_flip": 0.020408162847161293,
      "sparse_tokens": 4350.0,
      "step": 10090,
      "turn_loss": 0.28369230031967163,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.4688254971194945,
      "grad_norm": 0.7460259795188904,
      "learning_rate": 6.243398130682165e-07,
      "loss": 0.1347,
      "mae_dtheta": 0.026936624199151993,
      "mae_dx": 0.01382896676659584,
      "mae_dy": 0.00745120644569397,
      "pose_mae_dtheta": 0.21848832070827484,
      "pose_mae_dx": 0.1064714640378952,
      "pose_mae_dy": 0.12210429459810257,
      "pose_rmse_dtheta": 0.4048735797405243,
      "pose_rmse_dx": 0.2436886429786682,
      "pose_rmse_dy": 0.2758016288280487,
      "pose_rmse_mean": 0.30812129378318787,
      "rmse_dtheta": 0.045912113040685654,
      "rmse_dx": 0.02867382951080799,
      "rmse_dy": 0.015675241127610207,
      "rmse_mean": 0.03008706122636795,
      "rotation_flip": 0.004819277208298445,
      "sparse_tokens": 9493.0,
      "step": 10091,
      "turn_loss": 0.1967095285654068,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 31790.0,
      "epoch": 0.4688719568853373,
      "grad_norm": 0.36022961139678955,
      "learning_rate": 6.237001651282709e-07,
      "loss": 0.0933,
      "mae_dtheta": 0.032949358224868774,
      "mae_dx": 0.009785722941160202,
      "mae_dy": 0.005544473882764578,
      "pose_mae_dtheta": 0.2401105910539627,
      "pose_mae_dx": 0.0767764002084732,
      "pose_mae_dy": 0.05465208739042282,
      "pose_rmse_dtheta": 0.41954711079597473,
      "pose_rmse_dx": 0.18037445843219757,
      "pose_rmse_dy": 0.13517703115940094,
      "pose_rmse_mean": 0.2450328767299652,
      "rmse_dtheta": 0.050141554325819016,
      "rmse_dx": 0.021496452391147614,
      "rmse_dy": 0.011509192176163197,
      "rmse_mean": 0.027715733274817467,
      "rotation_flip": 0.009727626107633114,
      "sparse_tokens": 27416.0,
      "step": 10092,
      "turn_loss": 0.2412899136543274,
      "turns": 98.0,
      "turns_per_sample": 98.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.46891841665118006,
      "grad_norm": 0.4919170141220093,
      "learning_rate": 6.230608232253227e-07,
      "loss": 0.082,
      "mae_dtheta": 0.010058900341391563,
      "mae_dx": 0.0026589450426399708,
      "mae_dy": 0.0037642342504113913,
      "pose_mae_dtheta": 0.0683979019522667,
      "pose_mae_dx": 0.030035432428121567,
      "pose_mae_dy": 0.029982849955558777,
      "pose_rmse_dtheta": 0.18420220911502838,
      "pose_rmse_dx": 0.08758437633514404,
      "pose_rmse_dy": 0.07967422157526016,
      "pose_rmse_mean": 0.117153599858284,
      "rmse_dtheta": 0.022504596039652824,
      "rmse_dx": 0.006747783627361059,
      "rmse_dy": 0.008301971480250359,
      "rmse_mean": 0.012518118135631084,
      "rotation_flip": 0.007183365058153868,
      "sparse_tokens": 32105.0,
      "step": 10093,
      "turn_loss": 0.1041046679019928,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.46896487641702284,
      "grad_norm": 0.6081535816192627,
      "learning_rate": 6.224217874040789e-07,
      "loss": 0.1078,
      "mae_dtheta": 0.005727896932512522,
      "mae_dx": 0.0008885625284165144,
      "mae_dy": 0.0008091761264950037,
      "pose_mae_dtheta": 0.03383219242095947,
      "pose_mae_dx": 0.008726198226213455,
      "pose_mae_dy": 0.012328988872468472,
      "pose_rmse_dtheta": 0.08229758590459824,
      "pose_rmse_dx": 0.020071081817150116,
      "pose_rmse_dy": 0.029726464301347733,
      "pose_rmse_mean": 0.04403170943260193,
      "rmse_dtheta": 0.01571696065366268,
      "rmse_dx": 0.002875656820833683,
      "rmse_dy": 0.0016008801758289337,
      "rmse_mean": 0.0067311665043234825,
      "rotation_flip": 0.003441494656726718,
      "sparse_tokens": 32089.0,
      "step": 10094,
      "turn_loss": 0.04036692529916763,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.4690113361828656,
      "grad_norm": 0.5898607969284058,
      "learning_rate": 6.217830577092304e-07,
      "loss": 0.1328,
      "mae_dtheta": 0.05009269341826439,
      "mae_dx": 0.014534511603415012,
      "mae_dy": 0.003793195588514209,
      "pose_mae_dtheta": 0.41968902945518494,
      "pose_mae_dx": 0.14883878827095032,
      "pose_mae_dy": 0.03715118393301964,
      "pose_rmse_dtheta": 0.6800593137741089,
      "pose_rmse_dx": 0.2973768413066864,
      "pose_rmse_dy": 0.08471047878265381,
      "pose_rmse_mean": 0.3540489077568054,
      "rmse_dtheta": 0.06957823038101196,
      "rmse_dx": 0.027220070362091064,
      "rmse_dy": 0.009078060276806355,
      "rmse_mean": 0.0352921225130558,
      "rotation_flip": 0.019021738320589066,
      "sparse_tokens": 6068.0,
      "step": 10095,
      "turn_loss": 0.2776898443698883,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 7817.0,
      "epoch": 0.46905779594870844,
      "grad_norm": 0.6019590497016907,
      "learning_rate": 6.211446341854415e-07,
      "loss": 0.1433,
      "mae_dtheta": 0.032814305275678635,
      "mae_dx": 0.010973175056278706,
      "mae_dy": 0.002949786838144064,
      "pose_mae_dtheta": 0.24835523962974548,
      "pose_mae_dx": 0.07706066966056824,
      "pose_mae_dy": 0.039465826004743576,
      "pose_rmse_dtheta": 0.4747411608695984,
      "pose_rmse_dx": 0.1746494174003601,
      "pose_rmse_dy": 0.09750723838806152,
      "pose_rmse_mean": 0.24896594882011414,
      "rmse_dtheta": 0.056388989090919495,
      "rmse_dx": 0.02220235951244831,
      "rmse_dy": 0.005800800397992134,
      "rmse_mean": 0.02813071571290493,
      "rotation_flip": 0.005797101650387049,
      "sparse_tokens": 6508.0,
      "step": 10096,
      "turn_loss": 0.2100859433412552,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.4691042557145512,
      "grad_norm": 0.46579256653785706,
      "learning_rate": 6.205065168773589e-07,
      "loss": 0.1329,
      "mae_dtheta": 0.043193623423576355,
      "mae_dx": 0.010353335179388523,
      "mae_dy": 0.005113593302667141,
      "pose_mae_dtheta": 0.3524865508079529,
      "pose_mae_dx": 0.07243351638317108,
      "pose_mae_dy": 0.056810297071933746,
      "pose_rmse_dtheta": 0.5904696583747864,
      "pose_rmse_dx": 0.14639276266098022,
      "pose_rmse_dy": 0.14766676723957062,
      "pose_rmse_mean": 0.29484307765960693,
      "rmse_dtheta": 0.06192596256732941,
      "rmse_dx": 0.02087644301354885,
      "rmse_dy": 0.009946540929377079,
      "rmse_mean": 0.03091631643474102,
      "rotation_flip": 0.008658008649945259,
      "sparse_tokens": 11265.0,
      "step": 10097,
      "turn_loss": 0.31638166308403015,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.469150715480394,
      "grad_norm": 0.8986596465110779,
      "learning_rate": 6.198687058296071e-07,
      "loss": 0.1938,
      "mae_dtheta": 0.03684854507446289,
      "mae_dx": 0.006668258458375931,
      "mae_dy": 0.008367492817342281,
      "pose_mae_dtheta": 0.26008495688438416,
      "pose_mae_dx": 0.06452276557683945,
      "pose_mae_dy": 0.06965052336454391,
      "pose_rmse_dtheta": 0.4737432897090912,
      "pose_rmse_dx": 0.15922611951828003,
      "pose_rmse_dy": 0.17920240759849548,
      "pose_rmse_mean": 0.27072393894195557,
      "rmse_dtheta": 0.05816677212715149,
      "rmse_dx": 0.015646588057279587,
      "rmse_dy": 0.019238032400608063,
      "rmse_mean": 0.031017132103443146,
      "rotation_flip": 0.008653846569359303,
      "sparse_tokens": 15471.0,
      "step": 10098,
      "turn_loss": 0.3457118272781372,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4691971752462368,
      "grad_norm": 0.4447816014289856,
      "learning_rate": 6.192312010867868e-07,
      "loss": 0.1045,
      "mae_dtheta": 0.005421834997832775,
      "mae_dx": 0.001527409185655415,
      "mae_dy": 0.0014548221370205283,
      "pose_mae_dtheta": 0.036091148853302,
      "pose_mae_dx": 0.015881318598985672,
      "pose_mae_dy": 0.01586967706680298,
      "pose_rmse_dtheta": 0.11687379330396652,
      "pose_rmse_dx": 0.040258776396512985,
      "pose_rmse_dy": 0.03793392702937126,
      "pose_rmse_mean": 0.06502217054367065,
      "rmse_dtheta": 0.01495551597326994,
      "rmse_dx": 0.004404755774885416,
      "rmse_dy": 0.003312640590593219,
      "rmse_mean": 0.007557637523859739,
      "rotation_flip": 0.0032573288772255182,
      "sparse_tokens": 32089.0,
      "step": 10099,
      "turn_loss": 0.05474036559462547,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.46924363501207955,
      "grad_norm": 1.0010159015655518,
      "learning_rate": 6.185940026934805e-07,
      "loss": 0.1326,
      "mae_dtheta": 0.010369598865509033,
      "mae_dx": 0.0024282471276819706,
      "mae_dy": 0.002047406043857336,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999991059303284,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.1307373046875,
      "model/head/act_norm_mean": 112.30365175189394,
      "model/head/act_norm_min": 51.42372512817383,
      "model/head/act_over_embed": 77.17612088725434,
      "model/head/grad_frac": 0.0751502737402916,
      "model/head/grad_norm": 0.07515020668506622,
      "model/head/grad_zero_frac": 0.00016149133443832397,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7113813920454546,
      "model/head/update_ratio": 0.0012793660862371325,
      "model/head/weight_delta": 9.953575134277344,
      "model/head/weight_delta_rel": 0.17461518943309784,
      "model/head/weight_norm": 58.74019241333008,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42284661531448364,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227659163936492,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226931035518646,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905286957425843,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1968633532524109,
      "model/modality_embedder.encoders.pose/grad_norm": 0.19686317443847656,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.511916762672811,
      "model/modality_embedder.encoders.pose/update_ratio": 0.006356644444167614,
      "model/modality_embedder.encoders.pose/weight_delta": 3.149060010910034,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10288960486650467,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969669342041016,
      "model/modality_embedder/grad_frac": 0.1968633532524109,
      "model/modality_embedder/grad_norm": 0.19686317443847656,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.511916762672811,
      "model/modality_embedder/update_ratio": 0.006356644444167614,
      "model/modality_embedder/weight_delta": 3.149060010910034,
      "model/modality_embedder/weight_delta_rel": 0.10288960486650467,
      "model/modality_embedder/weight_norm": 30.969669342041016,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.49957275390625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.793563111271446,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.963889122009277,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.35115932891321,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.054396115243434906,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.054396066814661026,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019456951413303614,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7250914573669434,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09930397570133209,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.957138061523438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.70935821533203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.735732824274493,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.262129783630371,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.99862717642073,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.04821189492940903,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.048211850225925446,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016197731019929051,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.455352306365967,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11969610303640366,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.764570236206055,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.34224700927734,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.508898508898508,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.2000732421875,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.21716323553304,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.044895488768815994,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04489544779062271,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014606914483010769,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.742543935775757,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12566761672496796,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.735750198364258,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.99661254882812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.223782968574636,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.294428825378418,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.395647891223735,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.045136626809835434,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04513658583164215,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015070519875735044,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2155795097351074,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10989324748516083,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95025062561035,
      "model/normalizer/grad_frac": 0.1744537055492401,
      "model/normalizer/grad_norm": 0.17445355653762817,
      "model/normalizer/grad_zero_frac": 0.00023516594956163317,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0022180734667927027,
      "model/normalizer/weight_delta": 6.765340328216553,
      "model/normalizer/weight_delta_rel": 0.08713366836309433,
      "model/normalizer/weight_norm": 78.65093994140625,
      "pose_mae_dtheta": 0.07068692147731781,
      "pose_mae_dx": 0.02442212961614132,
      "pose_mae_dy": 0.02476649172604084,
      "pose_rmse_dtheta": 0.184426411986351,
      "pose_rmse_dx": 0.08341749757528305,
      "pose_rmse_dy": 0.0615144744515419,
      "pose_rmse_mean": 0.10978612303733826,
      "rmse_dtheta": 0.024667002260684967,
      "rmse_dx": 0.008880924433469772,
      "rmse_dy": 0.0062341815792024136,
      "rmse_mean": 0.013260702602565289,
      "rotation_flip": 0.004032257944345474,
      "sparse_tokens": 32057.0,
      "step": 10100,
      "turn_loss": 0.08880615234375,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.46929009477792233,
      "grad_norm": 0.5752481818199158,
      "learning_rate": 6.179571106942466e-07,
      "loss": 0.1436,
      "mae_dtheta": 0.006488405168056488,
      "mae_dx": 0.0012387277092784643,
      "mae_dy": 0.0013448067475110292,
      "pose_mae_dtheta": 0.04113505408167839,
      "pose_mae_dx": 0.014161360450088978,
      "pose_mae_dy": 0.016442015767097473,
      "pose_rmse_dtheta": 0.13427399098873138,
      "pose_rmse_dx": 0.039026811718940735,
      "pose_rmse_dy": 0.040045708417892456,
      "pose_rmse_mean": 0.07111550867557526,
      "rmse_dtheta": 0.0171870905905962,
      "rmse_dx": 0.004190841689705849,
      "rmse_dy": 0.0032989687751978636,
      "rmse_mean": 0.008225633762776852,
      "rotation_flip": 0.0036307054106146097,
      "sparse_tokens": 32073.0,
      "step": 10101,
      "turn_loss": 0.052382826805114746,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24338.0,
      "epoch": 0.4693365545437651,
      "grad_norm": 0.44628095626831055,
      "learning_rate": 6.173205251336239e-07,
      "loss": 0.1415,
      "mae_dtheta": 0.03488314151763916,
      "mae_dx": 0.011070191860198975,
      "mae_dy": 0.006990017369389534,
      "pose_mae_dtheta": 0.25877436995506287,
      "pose_mae_dx": 0.09176429361104965,
      "pose_mae_dy": 0.07180940359830856,
      "pose_rmse_dtheta": 0.4830667972564697,
      "pose_rmse_dx": 0.21294349431991577,
      "pose_rmse_dy": 0.158504456281662,
      "pose_rmse_mean": 0.2848382592201233,
      "rmse_dtheta": 0.05473088473081589,
      "rmse_dx": 0.022877780720591545,
      "rmse_dy": 0.014403177425265312,
      "rmse_mean": 0.030670616775751114,
      "rotation_flip": 0.015012510120868683,
      "sparse_tokens": 18860.0,
      "step": 10102,
      "turn_loss": 0.31424859166145325,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 14574.0,
      "epoch": 0.4693830143096079,
      "grad_norm": 0.4333113431930542,
      "learning_rate": 6.166842460561301e-07,
      "loss": 0.0956,
      "mae_dtheta": 0.037933941930532455,
      "mae_dx": 0.01410472672432661,
      "mae_dy": 0.004420547746121883,
      "pose_mae_dtheta": 0.2911311686038971,
      "pose_mae_dx": 0.1295320987701416,
      "pose_mae_dy": 0.07043006271123886,
      "pose_rmse_dtheta": 0.5280605554580688,
      "pose_rmse_dx": 0.27192604541778564,
      "pose_rmse_dy": 0.14450280368328094,
      "pose_rmse_mean": 0.31482982635498047,
      "rmse_dtheta": 0.05782007426023483,
      "rmse_dx": 0.028067246079444885,
      "rmse_dy": 0.007505999878048897,
      "rmse_mean": 0.031131107360124588,
      "rotation_flip": 0.006182380020618439,
      "sparse_tokens": 12409.0,
      "step": 10103,
      "turn_loss": 0.24491000175476074,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.46942947407545066,
      "grad_norm": 0.5592026114463806,
      "learning_rate": 6.16048273506259e-07,
      "loss": 0.1052,
      "mae_dtheta": 0.03487927466630936,
      "mae_dx": 0.015143570490181446,
      "mae_dy": 0.007334196008741856,
      "pose_mae_dtheta": 0.2577626407146454,
      "pose_mae_dx": 0.11319153010845184,
      "pose_mae_dy": 0.08471708744764328,
      "pose_rmse_dtheta": 0.45805639028549194,
      "pose_rmse_dx": 0.2148517221212387,
      "pose_rmse_dy": 0.19751442968845367,
      "pose_rmse_mean": 0.29014086723327637,
      "rmse_dtheta": 0.05280409753322601,
      "rmse_dx": 0.027409333735704422,
      "rmse_dy": 0.013631010428071022,
      "rmse_mean": 0.031281478703022,
      "rotation_flip": 0.012544803321361542,
      "sparse_tokens": 9227.0,
      "step": 10104,
      "turn_loss": 0.28324422240257263,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 16512.0,
      "epoch": 0.46947593384129344,
      "grad_norm": 0.34967944025993347,
      "learning_rate": 6.154126075284855e-07,
      "loss": 0.0813,
      "mae_dtheta": 0.03643554449081421,
      "mae_dx": 0.01115312147885561,
      "mae_dy": 0.0038953828625380993,
      "pose_mae_dtheta": 0.2815096080303192,
      "pose_mae_dx": 0.09046274423599243,
      "pose_mae_dy": 0.048528123646974564,
      "pose_rmse_dtheta": 0.4950050711631775,
      "pose_rmse_dx": 0.1990562081336975,
      "pose_rmse_dy": 0.1340586096048355,
      "pose_rmse_mean": 0.2760399580001831,
      "rmse_dtheta": 0.0543021596968174,
      "rmse_dx": 0.022409170866012573,
      "rmse_dy": 0.009962961077690125,
      "rmse_mean": 0.0288914293050766,
      "rotation_flip": 0.0139860138297081,
      "sparse_tokens": 12717.0,
      "step": 10105,
      "turn_loss": 0.29032590985298157,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.4695223936071362,
      "grad_norm": 0.5125138759613037,
      "learning_rate": 6.147772481672609e-07,
      "loss": 0.1472,
      "mae_dtheta": 0.029905125498771667,
      "mae_dx": 0.00918998010456562,
      "mae_dy": 0.0031935879960656166,
      "pose_mae_dtheta": 0.24650762975215912,
      "pose_mae_dx": 0.07059379667043686,
      "pose_mae_dy": 0.039334096014499664,
      "pose_rmse_dtheta": 0.4777306914329529,
      "pose_rmse_dx": 0.18536773324012756,
      "pose_rmse_dy": 0.08461408317089081,
      "pose_rmse_mean": 0.249237522482872,
      "rmse_dtheta": 0.050010811537504196,
      "rmse_dx": 0.020928576588630676,
      "rmse_dy": 0.0057349614799022675,
      "rmse_mean": 0.025558119639754295,
      "rotation_flip": 0.01508620660752058,
      "sparse_tokens": 9143.0,
      "step": 10106,
      "turn_loss": 0.1472470462322235,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.469568853372979,
      "grad_norm": 0.5463982820510864,
      "learning_rate": 6.141421954670184e-07,
      "loss": 0.1547,
      "mae_dtheta": 0.009343204088509083,
      "mae_dx": 0.0017178683774545789,
      "mae_dy": 0.0022486867383122444,
      "pose_mae_dtheta": 0.053991083055734634,
      "pose_mae_dx": 0.020805086940526962,
      "pose_mae_dy": 0.025207383558154106,
      "pose_rmse_dtheta": 0.11836569011211395,
      "pose_rmse_dx": 0.06875985860824585,
      "pose_rmse_dy": 0.057086262851953506,
      "pose_rmse_mean": 0.0814039409160614,
      "rmse_dtheta": 0.019233470782637596,
      "rmse_dx": 0.005115161649882793,
      "rmse_dy": 0.005668994504958391,
      "rmse_mean": 0.010005875490605831,
      "rotation_flip": 0.003543586004525423,
      "sparse_tokens": 32105.0,
      "step": 10107,
      "turn_loss": 0.08692628890275955,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.46961531313882177,
      "grad_norm": 0.3555763363838196,
      "learning_rate": 6.135074494721649e-07,
      "loss": 0.0663,
      "mae_dtheta": 0.007680301554501057,
      "mae_dx": 0.0010833651758730412,
      "mae_dy": 0.0012956151040270925,
      "pose_mae_dtheta": 0.05111987516283989,
      "pose_mae_dx": 0.013838947750627995,
      "pose_mae_dy": 0.018473949283361435,
      "pose_rmse_dtheta": 0.1418198049068451,
      "pose_rmse_dx": 0.042778704315423965,
      "pose_rmse_dy": 0.04962759092450142,
      "pose_rmse_mean": 0.0780753642320633,
      "rmse_dtheta": 0.018897157162427902,
      "rmse_dx": 0.003595931688323617,
      "rmse_dy": 0.0031149741262197495,
      "rmse_mean": 0.0085360212251544,
      "rotation_flip": 0.0034670629538595676,
      "sparse_tokens": 32089.0,
      "step": 10108,
      "turn_loss": 0.0617213137447834,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.46966177290466454,
      "grad_norm": 0.43194180727005005,
      "learning_rate": 6.128730102270897e-07,
      "loss": 0.0937,
      "mae_dtheta": 0.04212820529937744,
      "mae_dx": 0.009260648861527443,
      "mae_dy": 0.004876018967479467,
      "pose_mae_dtheta": 0.3443150520324707,
      "pose_mae_dx": 0.09947694092988968,
      "pose_mae_dy": 0.05239858478307724,
      "pose_rmse_dtheta": 0.5662249326705933,
      "pose_rmse_dx": 0.22378982603549957,
      "pose_rmse_dy": 0.18862134218215942,
      "pose_rmse_mean": 0.3262120485305786,
      "rmse_dtheta": 0.05960441753268242,
      "rmse_dx": 0.019427595660090446,
      "rmse_dy": 0.013148709200322628,
      "rmse_mean": 0.030726907774806023,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 10259.0,
      "step": 10109,
      "turn_loss": 0.3178011178970337,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4697082326705073,
      "grad_norm": 0.5023933053016663,
      "learning_rate": 6.122388777761612e-07,
      "loss": 0.1235,
      "mae_dtheta": 0.012599045410752296,
      "mae_dx": 0.0030232537537813187,
      "mae_dy": 0.0035786652006208897,
      "pose_mae_dtheta": 0.0865522250533104,
      "pose_mae_dx": 0.028953764587640762,
      "pose_mae_dy": 0.025545934215188026,
      "pose_rmse_dtheta": 0.23344533145427704,
      "pose_rmse_dx": 0.07547273486852646,
      "pose_rmse_dy": 0.05525119975209236,
      "pose_rmse_mean": 0.12138976156711578,
      "rmse_dtheta": 0.029182475060224533,
      "rmse_dx": 0.009476570412516594,
      "rmse_dy": 0.009399156086146832,
      "rmse_mean": 0.01601940020918846,
      "rotation_flip": 0.0067882901057600975,
      "sparse_tokens": 32073.0,
      "step": 10110,
      "turn_loss": 0.11416622251272202,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.4697546924363501,
      "grad_norm": 0.5628067255020142,
      "learning_rate": 6.116050521637218e-07,
      "loss": 0.1505,
      "mae_dtheta": 0.029360776767134666,
      "mae_dx": 0.018239451572299004,
      "mae_dy": 0.006130062509328127,
      "pose_mae_dtheta": 0.20873823761940002,
      "pose_mae_dx": 0.15103167295455933,
      "pose_mae_dy": 0.059351686388254166,
      "pose_rmse_dtheta": 0.31382057070732117,
      "pose_rmse_dx": 0.31329500675201416,
      "pose_rmse_dy": 0.11776421219110489,
      "pose_rmse_mean": 0.24829328060150146,
      "rmse_dtheta": 0.04116241633892059,
      "rmse_dx": 0.03239697962999344,
      "rmse_dy": 0.011569373309612274,
      "rmse_mean": 0.028376257047057152,
      "rotation_flip": 0.034090910106897354,
      "sparse_tokens": 7198.0,
      "step": 10111,
      "turn_loss": 0.32300132513046265,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4698011522021929,
      "grad_norm": 0.4860212802886963,
      "learning_rate": 6.109715334340971e-07,
      "loss": 0.102,
      "mae_dtheta": 0.009456281550228596,
      "mae_dx": 0.0016157709760591388,
      "mae_dy": 0.0024143941700458527,
      "pose_mae_dtheta": 0.06386008858680725,
      "pose_mae_dx": 0.017300685867667198,
      "pose_mae_dy": 0.023944269865751266,
      "pose_rmse_dtheta": 0.1686345636844635,
      "pose_rmse_dx": 0.04346999526023865,
      "pose_rmse_dy": 0.05095284432172775,
      "pose_rmse_mean": 0.08768580853939056,
      "rmse_dtheta": 0.021424852311611176,
      "rmse_dx": 0.004851610865443945,
      "rmse_dy": 0.00559256412088871,
      "rmse_mean": 0.010623009875416756,
      "rotation_flip": 0.0039093042723834515,
      "sparse_tokens": 32089.0,
      "step": 10112,
      "turn_loss": 0.08431960642337799,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.4698476119680357,
      "grad_norm": 0.43146586418151855,
      "learning_rate": 6.103383216315883e-07,
      "loss": 0.0883,
      "mae_dtheta": 0.006802406162023544,
      "mae_dx": 0.0017947384621948004,
      "mae_dy": 0.0019136160844936967,
      "pose_mae_dtheta": 0.05426989495754242,
      "pose_mae_dx": 0.02534322999417782,
      "pose_mae_dy": 0.024015942588448524,
      "pose_rmse_dtheta": 0.1498430073261261,
      "pose_rmse_dx": 0.08238260447978973,
      "pose_rmse_dy": 0.07438632845878601,
      "pose_rmse_mean": 0.10220398753881454,
      "rmse_dtheta": 0.018161829560995102,
      "rmse_dx": 0.006184572819620371,
      "rmse_dy": 0.005794452503323555,
      "rmse_mean": 0.010046951472759247,
      "rotation_flip": 0.0037678976077586412,
      "sparse_tokens": 32025.0,
      "step": 10113,
      "turn_loss": 0.07201666384935379,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30819.0,
      "epoch": 0.4698940717338785,
      "grad_norm": 0.8144742250442505,
      "learning_rate": 6.097054168004774e-07,
      "loss": 0.162,
      "mae_dtheta": 0.02960595116019249,
      "mae_dx": 0.009473913349211216,
      "mae_dy": 0.004662607796490192,
      "pose_mae_dtheta": 0.20768652856349945,
      "pose_mae_dx": 0.06916987895965576,
      "pose_mae_dy": 0.03858127072453499,
      "pose_rmse_dtheta": 0.38380229473114014,
      "pose_rmse_dx": 0.17504210770130157,
      "pose_rmse_dy": 0.08968797326087952,
      "pose_rmse_mean": 0.21617746353149414,
      "rmse_dtheta": 0.04725289344787598,
      "rmse_dx": 0.021081892773509026,
      "rmse_dy": 0.010502889752388,
      "rmse_mean": 0.026279225945472717,
      "rotation_flip": 0.027997128665447235,
      "sparse_tokens": 24333.0,
      "step": 10114,
      "turn_loss": 0.22816623747348785,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.46994053149972126,
      "grad_norm": 0.47073689103126526,
      "learning_rate": 6.09072818985022e-07,
      "loss": 0.0936,
      "mae_dtheta": 0.024564379826188087,
      "mae_dx": 0.006664901040494442,
      "mae_dy": 0.0036202436313033104,
      "pose_mae_dtheta": 0.18759706616401672,
      "pose_mae_dx": 0.05737907811999321,
      "pose_mae_dy": 0.045555755496025085,
      "pose_rmse_dtheta": 0.3499310314655304,
      "pose_rmse_dx": 0.14492693543434143,
      "pose_rmse_dy": 0.09904161095619202,
      "pose_rmse_mean": 0.1979665458202362,
      "rmse_dtheta": 0.04011288285255432,
      "rmse_dx": 0.01634499989449978,
      "rmse_dy": 0.007092910353094339,
      "rmse_mean": 0.021183598786592484,
      "rotation_flip": 0.015122873708605766,
      "sparse_tokens": 9987.0,
      "step": 10115,
      "turn_loss": 0.20830440521240234,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.46998699126556404,
      "grad_norm": 0.47540226578712463,
      "learning_rate": 6.084405282294625e-07,
      "loss": 0.1013,
      "mae_dtheta": 0.013222452253103256,
      "mae_dx": 0.0027285844553261995,
      "mae_dy": 0.0037752799689769745,
      "pose_mae_dtheta": 0.09408830851316452,
      "pose_mae_dx": 0.029996220022439957,
      "pose_mae_dy": 0.031677182763814926,
      "pose_rmse_dtheta": 0.24189123511314392,
      "pose_rmse_dx": 0.08455553650856018,
      "pose_rmse_dy": 0.07083127647638321,
      "pose_rmse_mean": 0.13242602348327637,
      "rmse_dtheta": 0.027889598160982132,
      "rmse_dx": 0.007941591553390026,
      "rmse_dy": 0.009191200137138367,
      "rmse_mean": 0.015007464215159416,
      "rotation_flip": 0.004657070152461529,
      "sparse_tokens": 32057.0,
      "step": 10116,
      "turn_loss": 0.1330939531326294,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.4700334510314068,
      "grad_norm": 0.5050755739212036,
      "learning_rate": 6.07808544578013e-07,
      "loss": 0.1158,
      "mae_dtheta": 0.032308999449014664,
      "mae_dx": 0.012369119562208652,
      "mae_dy": 0.005385954864323139,
      "pose_mae_dtheta": 0.27966782450675964,
      "pose_mae_dx": 0.10197966545820236,
      "pose_mae_dy": 0.07289097458124161,
      "pose_rmse_dtheta": 0.47548529505729675,
      "pose_rmse_dx": 0.2141955941915512,
      "pose_rmse_dy": 0.20107121765613556,
      "pose_rmse_mean": 0.2969173789024353,
      "rmse_dtheta": 0.04919365793466568,
      "rmse_dx": 0.024384645745158195,
      "rmse_dy": 0.011257730424404144,
      "rmse_mean": 0.02827867865562439,
      "rotation_flip": 0.009683098644018173,
      "sparse_tokens": 19234.0,
      "step": 10117,
      "turn_loss": 0.24040111899375916,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4700799107972496,
      "grad_norm": 0.32009679079055786,
      "learning_rate": 6.071768680748702e-07,
      "loss": 0.0774,
      "mae_dtheta": 0.01096012257039547,
      "mae_dx": 0.0017283445922657847,
      "mae_dy": 0.0026801652275025845,
      "pose_mae_dtheta": 0.0686664804816246,
      "pose_mae_dx": 0.022953957319259644,
      "pose_mae_dy": 0.029232680797576904,
      "pose_rmse_dtheta": 0.18308785557746887,
      "pose_rmse_dx": 0.059598155319690704,
      "pose_rmse_dy": 0.07938677072525024,
      "pose_rmse_mean": 0.10735759139060974,
      "rmse_dtheta": 0.02508409135043621,
      "rmse_dx": 0.00435748090967536,
      "rmse_dy": 0.006237118970602751,
      "rmse_mean": 0.011892898008227348,
      "rotation_flip": 0.005736823193728924,
      "sparse_tokens": 32185.0,
      "step": 10118,
      "turn_loss": 0.0865192860364914,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.47012637056309237,
      "grad_norm": 0.49125489592552185,
      "learning_rate": 6.065454987642055e-07,
      "loss": 0.1041,
      "mae_dtheta": 0.006922905799001455,
      "mae_dx": 0.0016696156235411763,
      "mae_dy": 0.0021226604003459215,
      "pose_mae_dtheta": 0.04656779393553734,
      "pose_mae_dx": 0.01897907443344593,
      "pose_mae_dy": 0.01881682313978672,
      "pose_rmse_dtheta": 0.12715351581573486,
      "pose_rmse_dx": 0.04871053248643875,
      "pose_rmse_dy": 0.0449255034327507,
      "pose_rmse_mean": 0.0735965222120285,
      "rmse_dtheta": 0.0175014678388834,
      "rmse_dx": 0.0044649443589150906,
      "rmse_dy": 0.005140161141753197,
      "rmse_mean": 0.009035524912178516,
      "rotation_flip": 0.001949317753314972,
      "sparse_tokens": 32153.0,
      "step": 10119,
      "turn_loss": 0.07452284544706345,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47017283032893514,
      "grad_norm": 0.5821709632873535,
      "learning_rate": 6.059144366901737e-07,
      "loss": 0.0958,
      "mae_dtheta": 0.013169351033866405,
      "mae_dx": 0.0016661295667290688,
      "mae_dy": 0.0032130880281329155,
      "pose_mae_dtheta": 0.08767697215080261,
      "pose_mae_dx": 0.021455639973282814,
      "pose_mae_dy": 0.030558116734027863,
      "pose_rmse_dtheta": 0.21451297402381897,
      "pose_rmse_dx": 0.04618745297193527,
      "pose_rmse_dy": 0.06232038512825966,
      "pose_rmse_mean": 0.10767360776662827,
      "rmse_dtheta": 0.02710225246846676,
      "rmse_dx": 0.004452325403690338,
      "rmse_dy": 0.006165286526083946,
      "rmse_mean": 0.012573289684951305,
      "rotation_flip": 0.004787743557244539,
      "sparse_tokens": 32121.0,
      "step": 10120,
      "turn_loss": 0.10074501484632492,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.4702192900947779,
      "grad_norm": 0.5849232077598572,
      "learning_rate": 6.052836818969027e-07,
      "loss": 0.0945,
      "mae_dtheta": 0.02467340975999832,
      "mae_dx": 0.008724655024707317,
      "mae_dy": 0.0047533861361444,
      "pose_mae_dtheta": 0.18716737627983093,
      "pose_mae_dx": 0.0634036511182785,
      "pose_mae_dy": 0.060837361961603165,
      "pose_rmse_dtheta": 0.33554545044898987,
      "pose_rmse_dx": 0.16781410574913025,
      "pose_rmse_dy": 0.15063218772411346,
      "pose_rmse_mean": 0.2179972529411316,
      "rmse_dtheta": 0.03799015283584595,
      "rmse_dx": 0.02037377841770649,
      "rmse_dy": 0.010003696195781231,
      "rmse_mean": 0.022789208218455315,
      "rotation_flip": 0.008733624592423439,
      "sparse_tokens": 12697.0,
      "step": 10121,
      "turn_loss": 0.19524231553077698,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.4702657498606207,
      "grad_norm": 0.5960177779197693,
      "learning_rate": 6.046532344285034e-07,
      "loss": 0.1506,
      "mae_dtheta": 0.03626728057861328,
      "mae_dx": 0.009468070231378078,
      "mae_dy": 0.004517743363976479,
      "pose_mae_dtheta": 0.3158950209617615,
      "pose_mae_dx": 0.07141239941120148,
      "pose_mae_dy": 0.05147504433989525,
      "pose_rmse_dtheta": 0.5447884798049927,
      "pose_rmse_dx": 0.17275746166706085,
      "pose_rmse_dy": 0.14501549303531647,
      "pose_rmse_mean": 0.28752046823501587,
      "rmse_dtheta": 0.053659018129110336,
      "rmse_dx": 0.021931692957878113,
      "rmse_dy": 0.00818178802728653,
      "rmse_mean": 0.02792416885495186,
      "rotation_flip": 0.013071895577013493,
      "sparse_tokens": 5431.0,
      "step": 10122,
      "turn_loss": 0.28709229826927185,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4703122096264635,
      "grad_norm": 0.6395795345306396,
      "learning_rate": 6.04023094329062e-07,
      "loss": 0.1339,
      "mae_dtheta": 0.008496389724314213,
      "mae_dx": 0.0011284095235168934,
      "mae_dy": 0.0022309888154268265,
      "pose_mae_dtheta": 0.04893696680665016,
      "pose_mae_dx": 0.016993626952171326,
      "pose_mae_dy": 0.02530566230416298,
      "pose_rmse_dtheta": 0.09600073099136353,
      "pose_rmse_dx": 0.04660611227154732,
      "pose_rmse_dy": 0.05526065453886986,
      "pose_rmse_mean": 0.06595583260059357,
      "rmse_dtheta": 0.017276864498853683,
      "rmse_dx": 0.003473804099485278,
      "rmse_dy": 0.004739620257169008,
      "rmse_mean": 0.008496763184666634,
      "rotation_flip": 0.007792207878082991,
      "sparse_tokens": 32073.0,
      "step": 10123,
      "turn_loss": 0.0661739706993103,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.47035866939230625,
      "grad_norm": 0.5547446608543396,
      "learning_rate": 6.033932616426457e-07,
      "loss": 0.1752,
      "mae_dtheta": 0.008340917527675629,
      "mae_dx": 0.0013866685330867767,
      "mae_dy": 0.0012931888923048973,
      "pose_mae_dtheta": 0.057355668395757675,
      "pose_mae_dx": 0.0139686930924654,
      "pose_mae_dy": 0.017054244875907898,
      "pose_rmse_dtheta": 0.19827881455421448,
      "pose_rmse_dx": 0.04613569751381874,
      "pose_rmse_dy": 0.09645915776491165,
      "pose_rmse_mean": 0.11362455785274506,
      "rmse_dtheta": 0.02612568996846676,
      "rmse_dx": 0.00407392019405961,
      "rmse_dy": 0.005382352042943239,
      "rmse_mean": 0.011860653758049011,
      "rotation_flip": 0.003530004993081093,
      "sparse_tokens": 32169.0,
      "step": 10124,
      "turn_loss": 0.05989351496100426,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.470405129158149,
      "grad_norm": 0.5032915472984314,
      "learning_rate": 6.027637364132972e-07,
      "loss": 0.1747,
      "mae_dtheta": 0.00946076586842537,
      "mae_dx": 0.003259682795032859,
      "mae_dy": 0.0025089739356189966,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5032914876937866,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.41578674316406,
      "model/head/act_norm_mean": 101.73405934343434,
      "model/head/act_norm_min": 58.5235481262207,
      "model/head/act_over_embed": 69.91259803007773,
      "model/head/grad_frac": 0.1295916736125946,
      "model/head/grad_norm": 0.06522238254547119,
      "model/head/grad_zero_frac": 0.00019988120766356587,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7047378077651515,
      "model/head/update_ratio": 0.0011103505967184901,
      "model/head/weight_delta": 9.955029487609863,
      "model/head/weight_delta_rel": 0.1746407002210617,
      "model/head/weight_norm": 58.74034881591797,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42283767461776733,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42276081841112834,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42268845438957214,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29052519236126784,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07529457658529282,
      "model/modality_embedder.encoders.pose/grad_norm": 0.037895120680332184,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5517083093317973,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012236236361786723,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1495208740234375,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10290466248989105,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969587326049805,
      "model/modality_embedder/grad_frac": 0.07529457658529282,
      "model/modality_embedder/grad_norm": 0.037895120680332184,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5517083093317973,
      "model/modality_embedder/update_ratio": 0.0012236236361786723,
      "model/modality_embedder/weight_delta": 3.1495208740234375,
      "model/modality_embedder/weight_delta_rel": 0.10290466248989105,
      "model/modality_embedder/weight_norm": 30.969587326049805,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.26847839355469,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.798989397947732,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.063671112060547,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.667678961771346,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0939515084028244,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04728499427437782,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000322788895573467,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0016913269646465778,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7257776260375977,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09932897984981537,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.957334518432617,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.6077880859375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.73585557960558,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.364843368530273,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.311502172886,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08701466768980026,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04379374161362648,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00030765816336497664,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014713263371959329,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4562034606933594,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11972559243440628,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76480484008789,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.31217956542969,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.53650092191759,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.509987831115723,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.54892251003011,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08548285067081451,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04302279278635979,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013997529167681932,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7435011863708496,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12569975852966309,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.735990524291992,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.2457046508789,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.296782307198974,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.311708450317383,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.758604358009453,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0753951445221901,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.037945736199617386,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012669481802731752,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.216420888900757,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10992199927568436,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.950502395629883,
      "model/normalizer/grad_frac": 0.28454121947288513,
      "model/normalizer/grad_norm": 0.14320717751979828,
      "model/normalizer/grad_zero_frac": 0.0002907076559495181,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018207875546067953,
      "model/normalizer/weight_delta": 6.76707124710083,
      "model/normalizer/weight_delta_rel": 0.08715596050024033,
      "model/normalizer/weight_norm": 78.65122985839844,
      "pose_mae_dtheta": 0.057941097766160965,
      "pose_mae_dx": 0.036483049392700195,
      "pose_mae_dy": 0.025597412139177322,
      "pose_rmse_dtheta": 0.14361530542373657,
      "pose_rmse_dx": 0.12240994721651077,
      "pose_rmse_dy": 0.06550198048353195,
      "pose_rmse_mean": 0.11050908267498016,
      "rmse_dtheta": 0.021228211000561714,
      "rmse_dx": 0.011481475085020065,
      "rmse_dy": 0.006099765654653311,
      "rmse_mean": 0.012936484068632126,
      "rotation_flip": 0.001319841598160565,
      "sparse_tokens": 32057.0,
      "step": 10125,
      "turn_loss": 0.10420704632997513,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4704515889239918,
      "grad_norm": 0.361044317483902,
      "learning_rate": 6.021345186850419e-07,
      "loss": 0.0968,
      "mae_dtheta": 0.01190103217959404,
      "mae_dx": 0.0021514357067644596,
      "mae_dy": 0.0032531681936234236,
      "pose_mae_dtheta": 0.08293305337429047,
      "pose_mae_dx": 0.028468770906329155,
      "pose_mae_dy": 0.031045852228999138,
      "pose_rmse_dtheta": 0.2331758290529251,
      "pose_rmse_dx": 0.08509387820959091,
      "pose_rmse_dy": 0.07794096320867538,
      "pose_rmse_mean": 0.13207022845745087,
      "rmse_dtheta": 0.02843766286969185,
      "rmse_dx": 0.006113674957305193,
      "rmse_dy": 0.008266857825219631,
      "rmse_mean": 0.01427273266017437,
      "rotation_flip": 0.007124895229935646,
      "sparse_tokens": 32089.0,
      "step": 10126,
      "turn_loss": 0.10256177932024002,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.4704980486898346,
      "grad_norm": 0.6329166889190674,
      "learning_rate": 6.015056085018794e-07,
      "loss": 0.2223,
      "mae_dtheta": 0.012816802598536015,
      "mae_dx": 0.002424631966277957,
      "mae_dy": 0.0026176413521170616,
      "pose_mae_dtheta": 0.08521030098199844,
      "pose_mae_dx": 0.03317670151591301,
      "pose_mae_dy": 0.03712085261940956,
      "pose_rmse_dtheta": 0.1922324299812317,
      "pose_rmse_dx": 0.09324055910110474,
      "pose_rmse_dy": 0.08372359722852707,
      "pose_rmse_mean": 0.1230655312538147,
      "rmse_dtheta": 0.026167184114456177,
      "rmse_dx": 0.00878871325403452,
      "rmse_dy": 0.005330347456037998,
      "rmse_mean": 0.013428747653961182,
      "rotation_flip": 0.004934948403388262,
      "sparse_tokens": 32025.0,
      "step": 10127,
      "turn_loss": 0.11620116978883743,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.47054450845567736,
      "grad_norm": 0.4098341166973114,
      "learning_rate": 6.008770059077907e-07,
      "loss": 0.0879,
      "mae_dtheta": 0.02583395317196846,
      "mae_dx": 0.0068743578158319,
      "mae_dy": 0.003916270099580288,
      "pose_mae_dtheta": 0.19008533656597137,
      "pose_mae_dx": 0.05177086964249611,
      "pose_mae_dy": 0.047847773879766464,
      "pose_rmse_dtheta": 0.35252946615219116,
      "pose_rmse_dx": 0.14378789067268372,
      "pose_rmse_dy": 0.10694859176874161,
      "pose_rmse_mean": 0.20108865201473236,
      "rmse_dtheta": 0.041463010013103485,
      "rmse_dx": 0.01808038540184498,
      "rmse_dy": 0.00806189514696598,
      "rmse_mean": 0.02253509685397148,
      "rotation_flip": 0.009776536375284195,
      "sparse_tokens": 14751.0,
      "step": 10128,
      "turn_loss": 0.1885136365890503,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4705909682215202,
      "grad_norm": 0.3720332384109497,
      "learning_rate": 6.002487109467347e-07,
      "loss": 0.0791,
      "mae_dtheta": 0.008107975125312805,
      "mae_dx": 0.0014855850022286177,
      "mae_dy": 0.0022245480213314295,
      "pose_mae_dtheta": 0.05467982590198517,
      "pose_mae_dx": 0.018575355410575867,
      "pose_mae_dy": 0.024690544232726097,
      "pose_rmse_dtheta": 0.10885719954967499,
      "pose_rmse_dx": 0.050503287464380264,
      "pose_rmse_dy": 0.05396709963679314,
      "pose_rmse_mean": 0.07110919803380966,
      "rmse_dtheta": 0.017114829272031784,
      "rmse_dx": 0.00425159465521574,
      "rmse_dy": 0.005522741470485926,
      "rmse_mean": 0.008963055908679962,
      "rotation_flip": 0.001516875228844583,
      "sparse_tokens": 32105.0,
      "step": 10129,
      "turn_loss": 0.08383176475763321,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15221.0,
      "epoch": 0.47063742798736297,
      "grad_norm": 0.5196402072906494,
      "learning_rate": 5.996207236626473e-07,
      "loss": 0.1368,
      "mae_dtheta": 0.025468796491622925,
      "mae_dx": 0.012259619310498238,
      "mae_dy": 0.006619440391659737,
      "pose_mae_dtheta": 0.20162536203861237,
      "pose_mae_dx": 0.09334384649991989,
      "pose_mae_dy": 0.07149749994277954,
      "pose_rmse_dtheta": 0.3108749985694885,
      "pose_rmse_dx": 0.19868114590644836,
      "pose_rmse_dy": 0.15540781617164612,
      "pose_rmse_mean": 0.22165465354919434,
      "rmse_dtheta": 0.03787408396601677,
      "rmse_dx": 0.02479039877653122,
      "rmse_dy": 0.010785765014588833,
      "rmse_mean": 0.024483416229486465,
      "rotation_flip": 0.01800554059445858,
      "sparse_tokens": 11977.0,
      "step": 10130,
      "turn_loss": 0.28763219714164734,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47068388775320574,
      "grad_norm": 0.6267132759094238,
      "learning_rate": 5.989930440994451e-07,
      "loss": 0.1282,
      "mae_dtheta": 0.008623948320746422,
      "mae_dx": 0.0030107905622571707,
      "mae_dy": 0.003560178680345416,
      "pose_mae_dtheta": 0.06238967552781105,
      "pose_mae_dx": 0.03486254811286926,
      "pose_mae_dy": 0.026167944073677063,
      "pose_rmse_dtheta": 0.1571384072303772,
      "pose_rmse_dx": 0.11172620952129364,
      "pose_rmse_dy": 0.06293811649084091,
      "pose_rmse_mean": 0.11060091853141785,
      "rmse_dtheta": 0.02017294242978096,
      "rmse_dx": 0.008341621607542038,
      "rmse_dy": 0.009715829975903034,
      "rmse_mean": 0.012743464671075344,
      "rotation_flip": 0.005540166050195694,
      "sparse_tokens": 32121.0,
      "step": 10131,
      "turn_loss": 0.09730105847120285,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4707303475190485,
      "grad_norm": 0.34954988956451416,
      "learning_rate": 5.983656723010206e-07,
      "loss": 0.0985,
      "mae_dtheta": 0.009737331420183182,
      "mae_dx": 0.00223427708260715,
      "mae_dy": 0.0026985525619238615,
      "pose_mae_dtheta": 0.06459599733352661,
      "pose_mae_dx": 0.026861140504479408,
      "pose_mae_dy": 0.028748497366905212,
      "pose_rmse_dtheta": 0.14763689041137695,
      "pose_rmse_dx": 0.06381099671125412,
      "pose_rmse_dy": 0.06607555598020554,
      "pose_rmse_mean": 0.09250782430171967,
      "rmse_dtheta": 0.021373707801103592,
      "rmse_dx": 0.006186103448271751,
      "rmse_dy": 0.005910277832299471,
      "rmse_mean": 0.011156696826219559,
      "rotation_flip": 0.005520504899322987,
      "sparse_tokens": 32089.0,
      "step": 10132,
      "turn_loss": 0.10731548070907593,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4707768072848913,
      "grad_norm": 0.566114068031311,
      "learning_rate": 5.97738608311248e-07,
      "loss": 0.1137,
      "mae_dtheta": 0.0073647648096084595,
      "mae_dx": 0.0016155047342181206,
      "mae_dy": 0.0018402609275653958,
      "pose_mae_dtheta": 0.050402890890836716,
      "pose_mae_dx": 0.016955964267253876,
      "pose_mae_dy": 0.019262008368968964,
      "pose_rmse_dtheta": 0.12224916368722916,
      "pose_rmse_dx": 0.045775409787893295,
      "pose_rmse_dy": 0.04719538986682892,
      "pose_rmse_mean": 0.07173998653888702,
      "rmse_dtheta": 0.01789131388068199,
      "rmse_dx": 0.005273866932839155,
      "rmse_dy": 0.005158534273505211,
      "rmse_mean": 0.009441238828003407,
      "rotation_flip": 0.004686035681515932,
      "sparse_tokens": 32105.0,
      "step": 10133,
      "turn_loss": 0.07161219418048859,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16835.0,
      "epoch": 0.4708232670507341,
      "grad_norm": 0.42005297541618347,
      "learning_rate": 5.971118521739766e-07,
      "loss": 0.0909,
      "mae_dtheta": 0.03854804113507271,
      "mae_dx": 0.014140229672193527,
      "mae_dy": 0.00949577521532774,
      "pose_mae_dtheta": 0.3207884132862091,
      "pose_mae_dx": 0.12372545152902603,
      "pose_mae_dy": 0.10648413747549057,
      "pose_rmse_dtheta": 0.5260640382766724,
      "pose_rmse_dx": 0.25901973247528076,
      "pose_rmse_dy": 0.2197391837835312,
      "pose_rmse_mean": 0.33494099974632263,
      "rmse_dtheta": 0.05730712413787842,
      "rmse_dx": 0.02691056579351425,
      "rmse_dy": 0.018696309998631477,
      "rmse_mean": 0.0343046672642231,
      "rotation_flip": 0.020053476095199585,
      "sparse_tokens": 13070.0,
      "step": 10134,
      "turn_loss": 0.3369544744491577,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47086972681657685,
      "grad_norm": 0.358955979347229,
      "learning_rate": 5.964854039330365e-07,
      "loss": 0.0817,
      "mae_dtheta": 0.006741706281900406,
      "mae_dx": 0.0016787300119176507,
      "mae_dy": 0.0015469500795006752,
      "pose_mae_dtheta": 0.04100160673260689,
      "pose_mae_dx": 0.01666541025042534,
      "pose_mae_dy": 0.017251741141080856,
      "pose_rmse_dtheta": 0.09510104358196259,
      "pose_rmse_dx": 0.04064778611063957,
      "pose_rmse_dy": 0.0417262427508831,
      "pose_rmse_mean": 0.059158362448215485,
      "rmse_dtheta": 0.016625061631202698,
      "rmse_dx": 0.004588664043694735,
      "rmse_dy": 0.0034119030460715294,
      "rmse_mean": 0.008208543062210083,
      "rotation_flip": 0.004770992323756218,
      "sparse_tokens": 32121.0,
      "step": 10135,
      "turn_loss": 0.06770182400941849,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.4709161865824196,
      "grad_norm": 0.43081194162368774,
      "learning_rate": 5.958592636322368e-07,
      "loss": 0.1191,
      "mae_dtheta": 0.027202874422073364,
      "mae_dx": 0.008228829130530357,
      "mae_dy": 0.006519878748804331,
      "pose_mae_dtheta": 0.20482710003852844,
      "pose_mae_dx": 0.06660983711481094,
      "pose_mae_dy": 0.08096608519554138,
      "pose_rmse_dtheta": 0.3266247510910034,
      "pose_rmse_dx": 0.14830739796161652,
      "pose_rmse_dy": 0.23826412856578827,
      "pose_rmse_mean": 0.23773209750652313,
      "rmse_dtheta": 0.04350786283612251,
      "rmse_dx": 0.01851547136902809,
      "rmse_dy": 0.015600962564349174,
      "rmse_mean": 0.02587476745247841,
      "rotation_flip": 0.017475727945566177,
      "sparse_tokens": 8222.0,
      "step": 10136,
      "turn_loss": 0.3516731560230255,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4709626463482624,
      "grad_norm": 0.3555375039577484,
      "learning_rate": 5.952334313153612e-07,
      "loss": 0.0645,
      "mae_dtheta": 0.005504101049154997,
      "mae_dx": 0.0009379181428812444,
      "mae_dy": 0.0010978399077430367,
      "pose_mae_dtheta": 0.03682786226272583,
      "pose_mae_dx": 0.009972448460757732,
      "pose_mae_dy": 0.017302360385656357,
      "pose_rmse_dtheta": 0.07918630540370941,
      "pose_rmse_dx": 0.023567846044898033,
      "pose_rmse_dy": 0.04192471504211426,
      "pose_rmse_mean": 0.048226289451122284,
      "rmse_dtheta": 0.014316962100565434,
      "rmse_dx": 0.0030012493953108788,
      "rmse_dy": 0.0030377970542758703,
      "rmse_mean": 0.0067853364162147045,
      "rotation_flip": 0.0016602103132754564,
      "sparse_tokens": 32073.0,
      "step": 10137,
      "turn_loss": 0.04494999349117279,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4710091061141052,
      "grad_norm": 0.6144474744796753,
      "learning_rate": 5.946079070261773e-07,
      "loss": 0.1712,
      "mae_dtheta": 0.008687068708240986,
      "mae_dx": 0.0011959020048379898,
      "mae_dy": 0.0017672755056992173,
      "pose_mae_dtheta": 0.05360729619860649,
      "pose_mae_dx": 0.015766087919473648,
      "pose_mae_dy": 0.024743786081671715,
      "pose_rmse_dtheta": 0.11387581378221512,
      "pose_rmse_dx": 0.0421011708676815,
      "pose_rmse_dy": 0.06148482859134674,
      "pose_rmse_mean": 0.07248727232217789,
      "rmse_dtheta": 0.01872257888317108,
      "rmse_dx": 0.0044970326125621796,
      "rmse_dy": 0.003706036601215601,
      "rmse_mean": 0.008975216187536716,
      "rotation_flip": 0.005270092282444239,
      "sparse_tokens": 32057.0,
      "step": 10138,
      "turn_loss": 0.07248804718255997,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.47105556587994796,
      "grad_norm": 0.5122833251953125,
      "learning_rate": 5.939826908084257e-07,
      "loss": 0.1793,
      "mae_dtheta": 0.04412358999252319,
      "mae_dx": 0.015764353796839714,
      "mae_dy": 0.004403494298458099,
      "pose_mae_dtheta": 0.35448136925697327,
      "pose_mae_dx": 0.13368047773838043,
      "pose_mae_dy": 0.05166252329945564,
      "pose_rmse_dtheta": 0.6064932346343994,
      "pose_rmse_dx": 0.27639326453208923,
      "pose_rmse_dy": 0.12105987966060638,
      "pose_rmse_mean": 0.33464881777763367,
      "rmse_dtheta": 0.06385519355535507,
      "rmse_dx": 0.02884635515511036,
      "rmse_dy": 0.008877545595169067,
      "rmse_mean": 0.033859699964523315,
      "rotation_flip": 0.0138248847797513,
      "sparse_tokens": 12685.0,
      "step": 10139,
      "turn_loss": 0.386619508266449,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.47110202564579073,
      "grad_norm": 0.5062136650085449,
      "learning_rate": 5.933577827058296e-07,
      "loss": 0.1054,
      "mae_dtheta": 0.030044306069612503,
      "mae_dx": 0.007204260211437941,
      "mae_dy": 0.004133571404963732,
      "pose_mae_dtheta": 0.263131707906723,
      "pose_mae_dx": 0.05966464802622795,
      "pose_mae_dy": 0.04765066131949425,
      "pose_rmse_dtheta": 0.5190926790237427,
      "pose_rmse_dx": 0.11246044188737869,
      "pose_rmse_dy": 0.10057549178600311,
      "pose_rmse_mean": 0.24404287338256836,
      "rmse_dtheta": 0.051381103694438934,
      "rmse_dx": 0.015042493119835854,
      "rmse_dy": 0.007778821513056755,
      "rmse_mean": 0.024734139442443848,
      "rotation_flip": 0.0030581040773540735,
      "sparse_tokens": 6262.0,
      "step": 10140,
      "turn_loss": 0.20188245177268982,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.4711484854116335,
      "grad_norm": 0.705940306186676,
      "learning_rate": 5.927331827620902e-07,
      "loss": 0.0903,
      "mae_dtheta": 0.034118618816137314,
      "mae_dx": 0.010539613664150238,
      "mae_dy": 0.005909372586756945,
      "pose_mae_dtheta": 0.21306103467941284,
      "pose_mae_dx": 0.09052946418523788,
      "pose_mae_dy": 0.05089528113603592,
      "pose_rmse_dtheta": 0.481357216835022,
      "pose_rmse_dx": 0.1986069232225418,
      "pose_rmse_dy": 0.09967704117298126,
      "pose_rmse_mean": 0.259880393743515,
      "rmse_dtheta": 0.05742151290178299,
      "rmse_dx": 0.022997355088591576,
      "rmse_dy": 0.011185722425580025,
      "rmse_mean": 0.030534863471984863,
      "rotation_flip": 0.01666666753590107,
      "sparse_tokens": 5882.0,
      "step": 10141,
      "turn_loss": 0.22202730178833008,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.4711949451774763,
      "grad_norm": 0.6218096017837524,
      "learning_rate": 5.921088910208834e-07,
      "loss": 0.172,
      "mae_dtheta": 0.03851624205708504,
      "mae_dx": 0.010163459926843643,
      "mae_dy": 0.003940042108297348,
      "pose_mae_dtheta": 0.3010746240615845,
      "pose_mae_dx": 0.09054067730903625,
      "pose_mae_dy": 0.03386497497558594,
      "pose_rmse_dtheta": 0.494398295879364,
      "pose_rmse_dx": 0.20469635725021362,
      "pose_rmse_dy": 0.10955770313739777,
      "pose_rmse_mean": 0.26955080032348633,
      "rmse_dtheta": 0.058003198355436325,
      "rmse_dx": 0.021310999989509583,
      "rmse_dy": 0.010512800887227058,
      "rmse_mean": 0.029942333698272705,
      "rotation_flip": 0.012500000186264515,
      "sparse_tokens": 19717.0,
      "step": 10142,
      "turn_loss": 0.29888659715652466,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.47124140494331906,
      "grad_norm": 0.35738837718963623,
      "learning_rate": 5.914849075258688e-07,
      "loss": 0.0778,
      "mae_dtheta": 0.007692853920161724,
      "mae_dx": 0.0009460668661631644,
      "mae_dy": 0.0013137663481757045,
      "pose_mae_dtheta": 0.05455946549773216,
      "pose_mae_dx": 0.012691184878349304,
      "pose_mae_dy": 0.01928810030221939,
      "pose_rmse_dtheta": 0.19040444493293762,
      "pose_rmse_dx": 0.03515198826789856,
      "pose_rmse_dy": 0.051512543112039566,
      "pose_rmse_mean": 0.09235632419586182,
      "rmse_dtheta": 0.02132618986070156,
      "rmse_dx": 0.0032992935739457607,
      "rmse_dy": 0.003083521733060479,
      "rmse_mean": 0.009236335754394531,
      "rotation_flip": 0.003900536336004734,
      "sparse_tokens": 32073.0,
      "step": 10143,
      "turn_loss": 0.05568423494696617,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.47128786470916184,
      "grad_norm": 0.5227647423744202,
      "learning_rate": 5.908612323206802e-07,
      "loss": 0.0989,
      "mae_dtheta": 0.009278427809476852,
      "mae_dx": 0.00140472874045372,
      "mae_dy": 0.001461852341890335,
      "pose_mae_dtheta": 0.05944528803229332,
      "pose_mae_dx": 0.015004157088696957,
      "pose_mae_dy": 0.021058684214949608,
      "pose_rmse_dtheta": 0.1415150761604309,
      "pose_rmse_dx": 0.03893263638019562,
      "pose_rmse_dy": 0.05695973336696625,
      "pose_rmse_mean": 0.07913582026958466,
      "rmse_dtheta": 0.021569984033703804,
      "rmse_dx": 0.004171820357441902,
      "rmse_dy": 0.0030896728858351707,
      "rmse_mean": 0.00961049273610115,
      "rotation_flip": 0.009032257832586765,
      "sparse_tokens": 32137.0,
      "step": 10144,
      "turn_loss": 0.07204653322696686,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4713343244750047,
      "grad_norm": 0.6272523999214172,
      "learning_rate": 5.902378654489327e-07,
      "loss": 0.1659,
      "mae_dtheta": 0.01178695634007454,
      "mae_dx": 0.0013428345555439591,
      "mae_dy": 0.002575456630438566,
      "pose_mae_dtheta": 0.07472274452447891,
      "pose_mae_dx": 0.023003453388810158,
      "pose_mae_dy": 0.03381909057497978,
      "pose_rmse_dtheta": 0.20379075407981873,
      "pose_rmse_dx": 0.05567796900868416,
      "pose_rmse_dy": 0.0722961574792862,
      "pose_rmse_mean": 0.11058829724788666,
      "rmse_dtheta": 0.02490411512553692,
      "rmse_dx": 0.003765177447348833,
      "rmse_dy": 0.00512150302529335,
      "rmse_mean": 0.011263599619269371,
      "rotation_flip": 0.0037792895454913378,
      "sparse_tokens": 32073.0,
      "step": 10145,
      "turn_loss": 0.08942797780036926,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.47138078424084745,
      "grad_norm": 0.958810031414032,
      "learning_rate": 5.896148069542173e-07,
      "loss": 0.2321,
      "mae_dtheta": 0.02703085169196129,
      "mae_dx": 0.005933593492954969,
      "mae_dy": 0.004321527201682329,
      "pose_mae_dtheta": 0.21484431624412537,
      "pose_mae_dx": 0.05051581934094429,
      "pose_mae_dy": 0.050572145730257034,
      "pose_rmse_dtheta": 0.4400259256362915,
      "pose_rmse_dx": 0.130863219499588,
      "pose_rmse_dy": 0.12816107273101807,
      "pose_rmse_mean": 0.2330167293548584,
      "rmse_dtheta": 0.04686003923416138,
      "rmse_dx": 0.015981074422597885,
      "rmse_dy": 0.009531354531645775,
      "rmse_mean": 0.024124158546328545,
      "rotation_flip": 0.0080106807872653,
      "sparse_tokens": 16130.0,
      "step": 10146,
      "turn_loss": 0.1847321093082428,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.4714272440066902,
      "grad_norm": 0.6182931661605835,
      "learning_rate": 5.889920568801055e-07,
      "loss": 0.1655,
      "mae_dtheta": 0.045545633882284164,
      "mae_dx": 0.017693324014544487,
      "mae_dy": 0.007303203921765089,
      "pose_mae_dtheta": 0.4045661389827728,
      "pose_mae_dx": 0.13025139272212982,
      "pose_mae_dy": 0.07687585055828094,
      "pose_rmse_dtheta": 0.6770540475845337,
      "pose_rmse_dx": 0.27521172165870667,
      "pose_rmse_dy": 0.17707589268684387,
      "pose_rmse_mean": 0.3764472007751465,
      "rmse_dtheta": 0.06667287647724152,
      "rmse_dx": 0.03143195062875748,
      "rmse_dy": 0.014169510453939438,
      "rmse_mean": 0.037424780428409576,
      "rotation_flip": 0.014141414314508438,
      "sparse_tokens": 8029.0,
      "step": 10147,
      "turn_loss": 0.45451897382736206,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.471473703772533,
      "grad_norm": 0.3876904845237732,
      "learning_rate": 5.883696152701479e-07,
      "loss": 0.05,
      "mae_dtheta": 0.007932956330478191,
      "mae_dx": 0.0011982080759480596,
      "mae_dy": 0.0014071257319301367,
      "pose_mae_dtheta": 0.052403658628463745,
      "pose_mae_dx": 0.013470483012497425,
      "pose_mae_dy": 0.016826683655381203,
      "pose_rmse_dtheta": 0.16130898892879486,
      "pose_rmse_dx": 0.03321094438433647,
      "pose_rmse_dy": 0.03802977502346039,
      "pose_rmse_mean": 0.077516570687294,
      "rmse_dtheta": 0.021114720031619072,
      "rmse_dx": 0.003687340999022126,
      "rmse_dy": 0.0030929148197174072,
      "rmse_mean": 0.009298325516283512,
      "rotation_flip": 0.0023331777192652225,
      "sparse_tokens": 32105.0,
      "step": 10148,
      "turn_loss": 0.057137105613946915,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20065.0,
      "epoch": 0.4715201635383758,
      "grad_norm": 0.47511518001556396,
      "learning_rate": 5.877474821678697e-07,
      "loss": 0.0934,
      "mae_dtheta": 0.014145459979772568,
      "mae_dx": 0.006833433173596859,
      "mae_dy": 0.0035341093316674232,
      "pose_mae_dtheta": 0.11224313080310822,
      "pose_mae_dx": 0.058700937777757645,
      "pose_mae_dy": 0.053485918790102005,
      "pose_rmse_dtheta": 0.22341251373291016,
      "pose_rmse_dx": 0.16483300924301147,
      "pose_rmse_dy": 0.12239106744527817,
      "pose_rmse_mean": 0.17021219432353973,
      "rmse_dtheta": 0.027773946523666382,
      "rmse_dx": 0.01905618980526924,
      "rmse_dy": 0.007038326933979988,
      "rmse_mean": 0.01795615628361702,
      "rotation_flip": 0.003759398590773344,
      "sparse_tokens": 15648.0,
      "step": 10149,
      "turn_loss": 0.1418086290359497,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.47156662330421856,
      "grad_norm": 0.4651840031147003,
      "learning_rate": 5.8712565761678e-07,
      "loss": 0.0851,
      "mae_dtheta": 0.02704515866935253,
      "mae_dx": 0.014960804022848606,
      "mae_dy": 0.005399413872510195,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4651840329170227,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 141.589599609375,
      "model/head/act_norm_mean": 104.68802584134616,
      "model/head/act_norm_min": 86.80420684814453,
      "model/head/act_over_embed": 71.94259146291282,
      "model/head/grad_frac": 0.08861403912305832,
      "model/head/grad_norm": 0.04122183471918106,
      "model/head/grad_zero_frac": 0.00019670849724207073,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6926457331730769,
      "model/head/update_ratio": 0.0007017616298981011,
      "model/head/weight_delta": 9.956233978271484,
      "model/head/weight_delta_rel": 0.17466183006763458,
      "model/head/weight_norm": 58.740509033203125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42276349663734436,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42276349663734436,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42276349663734436,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905270328633975,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06933052837848663,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03225145488977432,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010413875570520759,
      "model/modality_embedder.encoders.pose/weight_delta": 3.149822473526001,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10291451960802078,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969694137573242,
      "model/modality_embedder/grad_frac": 0.06933052837848663,
      "model/modality_embedder/grad_norm": 0.03225145488977432,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0010413875570520759,
      "model/modality_embedder/weight_delta": 3.149822473526001,
      "model/modality_embedder/weight_delta_rel": 0.10291451960802078,
      "model/modality_embedder/weight_norm": 30.969694137573242,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 74.59100341796875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.136337187118436,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.322066307067871,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.899507520789214,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06042812019586563,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.028110196813941002,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010054614394903183,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7264397144317627,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09935310482978821,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.957509994506836,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.09310150146484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.941036610958484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.713943481445312,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.4525044985668,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.056419361382722855,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02624538540840149,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.000881750660482794,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.457059860229492,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11975525319576263,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.765087127685547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 77.93338012695312,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.587447058150182,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.454838752746582,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.58393317181439,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.057283300906419754,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.026647277176380157,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008669647504575551,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7444441318511963,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1257314234972,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.736286163330078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 78.79146575927734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.461340525793652,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.30064868927002,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.87169030644603,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05722249671816826,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.026618991047143936,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008887646836228669,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2171380519866943,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10994651168584824,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.950550079345703,
      "model/normalizer/grad_frac": 0.21413704752922058,
      "model/normalizer/grad_norm": 0.09961313754320145,
      "model/normalizer/grad_zero_frac": 0.00022098507906775922,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001266513136215508,
      "model/normalizer/weight_delta": 6.768729209899902,
      "model/normalizer/weight_delta_rel": 0.08717731386423111,
      "model/normalizer/weight_norm": 78.65148162841797,
      "pose_mae_dtheta": 0.17811402678489685,
      "pose_mae_dx": 0.1293589323759079,
      "pose_mae_dy": 0.053272735327482224,
      "pose_rmse_dtheta": 0.2791638970375061,
      "pose_rmse_dx": 0.28657299280166626,
      "pose_rmse_dy": 0.10782505571842194,
      "pose_rmse_mean": 0.22452065348625183,
      "rmse_dtheta": 0.04368370398879051,
      "rmse_dx": 0.028697039932012558,
      "rmse_dy": 0.010491912253201008,
      "rmse_mean": 0.0276242196559906,
      "rotation_flip": 0.011655011214315891,
      "sparse_tokens": 6795.0,
      "step": 10150,
      "turn_loss": 0.27023202180862427,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.47161308307006133,
      "grad_norm": 0.6182088255882263,
      "learning_rate": 5.8650414166036e-07,
      "loss": 0.2057,
      "mae_dtheta": 0.00819430686533451,
      "mae_dx": 0.0017835792386904359,
      "mae_dy": 0.00226410455070436,
      "pose_mae_dtheta": 0.05555993691086769,
      "pose_mae_dx": 0.01874951831996441,
      "pose_mae_dy": 0.025333266705274582,
      "pose_rmse_dtheta": 0.14526620507240295,
      "pose_rmse_dx": 0.05812029168009758,
      "pose_rmse_dy": 0.0695301741361618,
      "pose_rmse_mean": 0.09097222983837128,
      "rmse_dtheta": 0.01900743693113327,
      "rmse_dx": 0.005481554660946131,
      "rmse_dy": 0.006765376776456833,
      "rmse_mean": 0.010418122634291649,
      "rotation_flip": 0.004347825888544321,
      "sparse_tokens": 32089.0,
      "step": 10151,
      "turn_loss": 0.09063131362199783,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.4716595428359041,
      "grad_norm": 0.48691388964653015,
      "learning_rate": 5.858829343420752e-07,
      "loss": 0.1616,
      "mae_dtheta": 0.03470739349722862,
      "mae_dx": 0.012700586579740047,
      "mae_dy": 0.00515308091416955,
      "pose_mae_dtheta": 0.27656087279319763,
      "pose_mae_dx": 0.09101593494415283,
      "pose_mae_dy": 0.06489711999893188,
      "pose_rmse_dtheta": 0.4809591770172119,
      "pose_rmse_dx": 0.19986829161643982,
      "pose_rmse_dy": 0.14504992961883545,
      "pose_rmse_mean": 0.2752924859523773,
      "rmse_dtheta": 0.05179109796881676,
      "rmse_dx": 0.025164682418107986,
      "rmse_dy": 0.009513353928923607,
      "rmse_mean": 0.028823046013712883,
      "rotation_flip": 0.007507507689297199,
      "sparse_tokens": 12129.0,
      "step": 10152,
      "turn_loss": 0.25302016735076904,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.4717060026017469,
      "grad_norm": 0.6572991013526917,
      "learning_rate": 5.852620357053651e-07,
      "loss": 0.1015,
      "mae_dtheta": 0.031124375760555267,
      "mae_dx": 0.009017451666295528,
      "mae_dy": 0.005138732958585024,
      "pose_mae_dtheta": 0.26035407185554504,
      "pose_mae_dx": 0.08922245353460312,
      "pose_mae_dy": 0.08411046117544174,
      "pose_rmse_dtheta": 0.4722816050052643,
      "pose_rmse_dx": 0.20390713214874268,
      "pose_rmse_dy": 0.20559144020080566,
      "pose_rmse_mean": 0.2939267158508301,
      "rmse_dtheta": 0.04864044487476349,
      "rmse_dx": 0.020931322127580643,
      "rmse_dy": 0.010044123977422714,
      "rmse_mean": 0.026538630947470665,
      "rotation_flip": 0.004597701132297516,
      "sparse_tokens": 7871.0,
      "step": 10153,
      "turn_loss": 0.20921455323696136,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.47175246236758966,
      "grad_norm": 0.7216079831123352,
      "learning_rate": 5.846414457936516e-07,
      "loss": 0.2215,
      "mae_dtheta": 0.029487989842891693,
      "mae_dx": 0.009986085817217827,
      "mae_dy": 0.004510784056037664,
      "pose_mae_dtheta": 0.21056659519672394,
      "pose_mae_dx": 0.08447843790054321,
      "pose_mae_dy": 0.07212591916322708,
      "pose_rmse_dtheta": 0.3963177502155304,
      "pose_rmse_dx": 0.22733652591705322,
      "pose_rmse_dy": 0.15903271734714508,
      "pose_rmse_mean": 0.26089566946029663,
      "rmse_dtheta": 0.046354133635759354,
      "rmse_dx": 0.024432066828012466,
      "rmse_dy": 0.008789694868028164,
      "rmse_mean": 0.02652529999613762,
      "rotation_flip": 0.014925372786819935,
      "sparse_tokens": 10740.0,
      "step": 10154,
      "turn_loss": 0.17428189516067505,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47179892213343244,
      "grad_norm": 0.23561103641986847,
      "learning_rate": 5.840211646503302e-07,
      "loss": 0.0598,
      "mae_dtheta": 0.008873311802744865,
      "mae_dx": 0.001537865144200623,
      "mae_dy": 0.002444974146783352,
      "pose_mae_dtheta": 0.05861625820398331,
      "pose_mae_dx": 0.021183716133236885,
      "pose_mae_dy": 0.02679990604519844,
      "pose_rmse_dtheta": 0.10959809273481369,
      "pose_rmse_dx": 0.05039593577384949,
      "pose_rmse_dy": 0.05547242611646652,
      "pose_rmse_mean": 0.0718221589922905,
      "rmse_dtheta": 0.01683717407286167,
      "rmse_dx": 0.004139371681958437,
      "rmse_dy": 0.005009903572499752,
      "rmse_mean": 0.008662149310112,
      "rotation_flip": 0.002456140238791704,
      "sparse_tokens": 32121.0,
      "step": 10155,
      "turn_loss": 0.07412651926279068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4718453818992752,
      "grad_norm": 0.4347507357597351,
      "learning_rate": 5.834011923187804e-07,
      "loss": 0.0912,
      "mae_dtheta": 0.011215350590646267,
      "mae_dx": 0.002264829585328698,
      "mae_dy": 0.00380005594342947,
      "pose_mae_dtheta": 0.08077722042798996,
      "pose_mae_dx": 0.02857084758579731,
      "pose_mae_dy": 0.030606688931584358,
      "pose_rmse_dtheta": 0.2026105523109436,
      "pose_rmse_dx": 0.08419892936944962,
      "pose_rmse_dy": 0.07664267718791962,
      "pose_rmse_mean": 0.12115071713924408,
      "rmse_dtheta": 0.023400679230690002,
      "rmse_dx": 0.006724260747432709,
      "rmse_dy": 0.009608146734535694,
      "rmse_mean": 0.01324436254799366,
      "rotation_flip": 0.002333722310140729,
      "sparse_tokens": 32089.0,
      "step": 10156,
      "turn_loss": 0.10165891796350479,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.471891841665118,
      "grad_norm": 0.48361268639564514,
      "learning_rate": 5.827815288423544e-07,
      "loss": 0.1017,
      "mae_dtheta": 0.02442070096731186,
      "mae_dx": 0.010134782642126083,
      "mae_dy": 0.004859762266278267,
      "pose_mae_dtheta": 0.17310373485088348,
      "pose_mae_dx": 0.08575423806905746,
      "pose_mae_dy": 0.04562192037701607,
      "pose_rmse_dtheta": 0.3261181116104126,
      "pose_rmse_dx": 0.1959579735994339,
      "pose_rmse_dy": 0.09618528932332993,
      "pose_rmse_mean": 0.2060871124267578,
      "rmse_dtheta": 0.040474601089954376,
      "rmse_dx": 0.0222218856215477,
      "rmse_dy": 0.008674618788063526,
      "rmse_mean": 0.023790370672941208,
      "rotation_flip": 0.010266940109431744,
      "sparse_tokens": 19452.0,
      "step": 10157,
      "turn_loss": 0.22348716855049133,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.47193830143096077,
      "grad_norm": 0.41910725831985474,
      "learning_rate": 5.821621742643884e-07,
      "loss": 0.082,
      "mae_dtheta": 0.008063073270022869,
      "mae_dx": 0.0015896512195467949,
      "mae_dy": 0.0016689475160092115,
      "pose_mae_dtheta": 0.055200591683387756,
      "pose_mae_dx": 0.02071226015686989,
      "pose_mae_dy": 0.0208786278963089,
      "pose_rmse_dtheta": 0.1361287534236908,
      "pose_rmse_dx": 0.06294429302215576,
      "pose_rmse_dy": 0.05916357785463333,
      "pose_rmse_mean": 0.08607887476682663,
      "rmse_dtheta": 0.0181106086820364,
      "rmse_dx": 0.0054138535633683205,
      "rmse_dy": 0.004286198876798153,
      "rmse_mean": 0.00927022099494934,
      "rotation_flip": 0.0020090406760573387,
      "sparse_tokens": 32073.0,
      "step": 10158,
      "turn_loss": 0.06977735459804535,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47198476119680355,
      "grad_norm": 0.34891247749328613,
      "learning_rate": 5.815431286281925e-07,
      "loss": 0.0975,
      "mae_dtheta": 0.008701126091182232,
      "mae_dx": 0.001114644925110042,
      "mae_dy": 0.001350308652035892,
      "pose_mae_dtheta": 0.05870475620031357,
      "pose_mae_dx": 0.014749622903764248,
      "pose_mae_dy": 0.019424259662628174,
      "pose_rmse_dtheta": 0.1811748892068863,
      "pose_rmse_dx": 0.043449513614177704,
      "pose_rmse_dy": 0.05395239591598511,
      "pose_rmse_mean": 0.0928589329123497,
      "rmse_dtheta": 0.023366449400782585,
      "rmse_dx": 0.003273452864959836,
      "rmse_dy": 0.003292859299108386,
      "rmse_mean": 0.00997758749872446,
      "rotation_flip": 0.0009136592270806432,
      "sparse_tokens": 32105.0,
      "step": 10159,
      "turn_loss": 0.05736807733774185,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 42706.0,
      "epoch": 0.4720312209626463,
      "grad_norm": 0.5084020495414734,
      "learning_rate": 5.809243919770563e-07,
      "loss": 0.1693,
      "mae_dtheta": 0.03927920013666153,
      "mae_dx": 0.010260756127536297,
      "mae_dy": 0.003722393186762929,
      "pose_mae_dtheta": 0.333506315946579,
      "pose_mae_dx": 0.08175791054964066,
      "pose_mae_dy": 0.04355539008975029,
      "pose_rmse_dtheta": 0.5347495079040527,
      "pose_rmse_dx": 0.1870316118001938,
      "pose_rmse_dy": 0.11512085050344467,
      "pose_rmse_mean": 0.27896732091903687,
      "rmse_dtheta": 0.05617018789052963,
      "rmse_dx": 0.021777845919132233,
      "rmse_dy": 0.008436284027993679,
      "rmse_mean": 0.028794772922992706,
      "rotation_flip": 0.01109430193901062,
      "sparse_tokens": 30106.0,
      "step": 10160,
      "turn_loss": 0.30665990710258484,
      "turns": 132.0,
      "turns_per_sample": 132.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4720776807284891,
      "grad_norm": 0.4007556438446045,
      "learning_rate": 5.803059643542491e-07,
      "loss": 0.074,
      "mae_dtheta": 0.009050155058503151,
      "mae_dx": 0.00232711061835289,
      "mae_dy": 0.0025143723469227552,
      "pose_mae_dtheta": 0.06149560958147049,
      "pose_mae_dx": 0.02533237636089325,
      "pose_mae_dy": 0.021928854286670685,
      "pose_rmse_dtheta": 0.18011584877967834,
      "pose_rmse_dx": 0.0769931823015213,
      "pose_rmse_dy": 0.055105820298194885,
      "pose_rmse_mean": 0.10407161712646484,
      "rmse_dtheta": 0.022444332018494606,
      "rmse_dx": 0.0071763815358281136,
      "rmse_dy": 0.006726027932018042,
      "rmse_mean": 0.012115580961108208,
      "rotation_flip": 0.0071428571827709675,
      "sparse_tokens": 32121.0,
      "step": 10161,
      "turn_loss": 0.07893893867731094,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47212414049433193,
      "grad_norm": 0.42327994108200073,
      "learning_rate": 5.796878458030192e-07,
      "loss": 0.072,
      "mae_dtheta": 0.008528508245944977,
      "mae_dx": 0.0012950246455147862,
      "mae_dy": 0.0018008934566751122,
      "pose_mae_dtheta": 0.05802852287888527,
      "pose_mae_dx": 0.016328511759638786,
      "pose_mae_dy": 0.01865420863032341,
      "pose_rmse_dtheta": 0.17362435162067413,
      "pose_rmse_dx": 0.046471551060676575,
      "pose_rmse_dy": 0.04981900751590729,
      "pose_rmse_mean": 0.0899716466665268,
      "rmse_dtheta": 0.020466651767492294,
      "rmse_dx": 0.00399805000051856,
      "rmse_dy": 0.004438608884811401,
      "rmse_mean": 0.009634437039494514,
      "rotation_flip": 0.0028653296176344156,
      "sparse_tokens": 32105.0,
      "step": 10162,
      "turn_loss": 0.07271747291088104,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4721706002601747,
      "grad_norm": 0.29136157035827637,
      "learning_rate": 5.790700363665891e-07,
      "loss": 0.0886,
      "mae_dtheta": 0.008037792518734932,
      "mae_dx": 0.0010386168723925948,
      "mae_dy": 0.0013746796175837517,
      "pose_mae_dtheta": 0.053624093532562256,
      "pose_mae_dx": 0.013012927956879139,
      "pose_mae_dy": 0.01833701692521572,
      "pose_rmse_dtheta": 0.1787000596523285,
      "pose_rmse_dx": 0.040384579449892044,
      "pose_rmse_dy": 0.051015403121709824,
      "pose_rmse_mean": 0.09003334492444992,
      "rmse_dtheta": 0.020799914374947548,
      "rmse_dx": 0.003613078035414219,
      "rmse_dy": 0.004128511529415846,
      "rmse_mean": 0.009513835422694683,
      "rotation_flip": 0.002072538947686553,
      "sparse_tokens": 32041.0,
      "step": 10163,
      "turn_loss": 0.05052081122994423,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4722170600260175,
      "grad_norm": 0.5523989796638489,
      "learning_rate": 5.78452536088166e-07,
      "loss": 0.1502,
      "mae_dtheta": 0.013744347728788853,
      "mae_dx": 0.0032051056623458862,
      "mae_dy": 0.004908911418169737,
      "pose_mae_dtheta": 0.08374536782503128,
      "pose_mae_dx": 0.03632054477930069,
      "pose_mae_dy": 0.03820313513278961,
      "pose_rmse_dtheta": 0.17430365085601807,
      "pose_rmse_dx": 0.08897827565670013,
      "pose_rmse_dy": 0.08963237702846527,
      "pose_rmse_mean": 0.11763811111450195,
      "rmse_dtheta": 0.026516703888773918,
      "rmse_dx": 0.007292290683835745,
      "rmse_dy": 0.009528745897114277,
      "rmse_mean": 0.014445913955569267,
      "rotation_flip": 0.004767959471791983,
      "sparse_tokens": 32105.0,
      "step": 10164,
      "turn_loss": 0.13549840450286865,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47226351979186026,
      "grad_norm": 0.6148203015327454,
      "learning_rate": 5.778353450109286e-07,
      "loss": 0.1881,
      "mae_dtheta": 0.00746491365134716,
      "mae_dx": 0.0018153343116864562,
      "mae_dy": 0.0011192559031769633,
      "pose_mae_dtheta": 0.05794564634561539,
      "pose_mae_dx": 0.018698448315262794,
      "pose_mae_dy": 0.01779807358980179,
      "pose_rmse_dtheta": 0.19600000977516174,
      "pose_rmse_dx": 0.05370354279875755,
      "pose_rmse_dy": 0.05706946551799774,
      "pose_rmse_mean": 0.10225766897201538,
      "rmse_dtheta": 0.020885808393359184,
      "rmse_dx": 0.005986066535115242,
      "rmse_dy": 0.0029623780865222216,
      "rmse_mean": 0.009944751858711243,
      "rotation_flip": 0.003914988599717617,
      "sparse_tokens": 32105.0,
      "step": 10165,
      "turn_loss": 0.07069562375545502,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.47230997955770304,
      "grad_norm": 1.1829415559768677,
      "learning_rate": 5.772184631780398e-07,
      "loss": 0.2837,
      "mae_dtheta": 0.02347792312502861,
      "mae_dx": 0.0026906311977654696,
      "mae_dy": 0.003664255142211914,
      "pose_mae_dtheta": 0.18669067323207855,
      "pose_mae_dx": 0.043272074311971664,
      "pose_mae_dy": 0.07058268040418625,
      "pose_rmse_dtheta": 0.3336643576622009,
      "pose_rmse_dx": 0.09402821213006973,
      "pose_rmse_dy": 0.150007963180542,
      "pose_rmse_mean": 0.19256684184074402,
      "rmse_dtheta": 0.03735439106822014,
      "rmse_dx": 0.007161278743296862,
      "rmse_dy": 0.00633835606276989,
      "rmse_mean": 0.016951343044638634,
      "rotation_flip": 0.004651162773370743,
      "sparse_tokens": 8710.0,
      "step": 10166,
      "turn_loss": 0.15144957602024078,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 27816.0,
      "epoch": 0.4723564393235458,
      "grad_norm": 0.49377256631851196,
      "learning_rate": 5.766018906326382e-07,
      "loss": 0.13,
      "mae_dtheta": 0.03835452347993851,
      "mae_dx": 0.010162829421460629,
      "mae_dy": 0.004839507397264242,
      "pose_mae_dtheta": 0.2953152656555176,
      "pose_mae_dx": 0.08878552913665771,
      "pose_mae_dy": 0.04493393376469612,
      "pose_rmse_dtheta": 0.5207405686378479,
      "pose_rmse_dx": 0.18581567704677582,
      "pose_rmse_dy": 0.10777430236339569,
      "pose_rmse_mean": 0.27144354581832886,
      "rmse_dtheta": 0.058703936636447906,
      "rmse_dx": 0.021437808871269226,
      "rmse_dy": 0.010354735888540745,
      "rmse_mean": 0.030165493488311768,
      "rotation_flip": 0.013718411326408386,
      "sparse_tokens": 22594.0,
      "step": 10167,
      "turn_loss": 0.30616238713264465,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4724028990893886,
      "grad_norm": 0.5528814792633057,
      "learning_rate": 5.759856274178399e-07,
      "loss": 0.0839,
      "mae_dtheta": 0.009320110082626343,
      "mae_dx": 0.0015738094225525856,
      "mae_dy": 0.0014293139101937413,
      "pose_mae_dtheta": 0.06644024699926376,
      "pose_mae_dx": 0.017375074326992035,
      "pose_mae_dy": 0.019173627719283104,
      "pose_rmse_dtheta": 0.1972368210554123,
      "pose_rmse_dx": 0.046781063079833984,
      "pose_rmse_dy": 0.04838137701153755,
      "pose_rmse_mean": 0.09746642410755157,
      "rmse_dtheta": 0.024648739024996758,
      "rmse_dx": 0.004398123826831579,
      "rmse_dy": 0.0032054639887064695,
      "rmse_mean": 0.010750776156783104,
      "rotation_flip": 0.0031347961630672216,
      "sparse_tokens": 32185.0,
      "step": 10168,
      "turn_loss": 0.06970136612653732,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.47244935885523137,
      "grad_norm": 0.44306373596191406,
      "learning_rate": 5.753696735767417e-07,
      "loss": 0.0985,
      "mae_dtheta": 0.03246099874377251,
      "mae_dx": 0.014176643453538418,
      "mae_dy": 0.0048021371476352215,
      "pose_mae_dtheta": 0.29144686460494995,
      "pose_mae_dx": 0.10934720933437347,
      "pose_mae_dy": 0.0631147027015686,
      "pose_rmse_dtheta": 0.4806579649448395,
      "pose_rmse_dx": 0.2493705451488495,
      "pose_rmse_dy": 0.15417253971099854,
      "pose_rmse_mean": 0.2947337031364441,
      "rmse_dtheta": 0.04912581667304039,
      "rmse_dx": 0.027997097000479698,
      "rmse_dy": 0.00873169582337141,
      "rmse_mean": 0.02861820161342621,
      "rotation_flip": 0.015748031437397003,
      "sparse_tokens": 13144.0,
      "step": 10169,
      "turn_loss": 0.2616952657699585,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.47249581862107415,
      "grad_norm": 0.46768680214881897,
      "learning_rate": 5.747540291524162e-07,
      "loss": 0.1405,
      "mae_dtheta": 0.03640707954764366,
      "mae_dx": 0.014507826417684555,
      "mae_dy": 0.004206364508718252,
      "pose_mae_dtheta": 0.25584015250205994,
      "pose_mae_dx": 0.10223866999149323,
      "pose_mae_dy": 0.05826383829116821,
      "pose_rmse_dtheta": 0.4072816073894501,
      "pose_rmse_dx": 0.21356739103794098,
      "pose_rmse_dy": 0.15416711568832397,
      "pose_rmse_mean": 0.25833871960639954,
      "rmse_dtheta": 0.053355585783720016,
      "rmse_dx": 0.02683641016483307,
      "rmse_dy": 0.010008782148361206,
      "rmse_mean": 0.030066927894949913,
      "rotation_flip": 0.02143622748553753,
      "sparse_tokens": 14539.0,
      "step": 10170,
      "turn_loss": 0.30489248037338257,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 32015.0,
      "epoch": 0.4725422783869169,
      "grad_norm": 0.9522072076797485,
      "learning_rate": 5.741386941879179e-07,
      "loss": 0.2251,
      "mae_dtheta": 0.03443482890725136,
      "mae_dx": 0.01272097323089838,
      "mae_dy": 0.004372213501483202,
      "pose_mae_dtheta": 0.2854224145412445,
      "pose_mae_dx": 0.10179422795772552,
      "pose_mae_dy": 0.06480054557323456,
      "pose_rmse_dtheta": 0.5341139435768127,
      "pose_rmse_dx": 0.23373091220855713,
      "pose_rmse_dy": 0.13985592126846313,
      "pose_rmse_mean": 0.3025669455528259,
      "rmse_dtheta": 0.05314057320356369,
      "rmse_dx": 0.026216251775622368,
      "rmse_dy": 0.007428830023854971,
      "rmse_mean": 0.02892855368554592,
      "rotation_flip": 0.009826152585446835,
      "sparse_tokens": 26235.0,
      "step": 10171,
      "turn_loss": 0.21710160374641418,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4725887381527597,
      "grad_norm": 0.4284653663635254,
      "learning_rate": 5.735236687262751e-07,
      "loss": 0.0942,
      "mae_dtheta": 0.010317922569811344,
      "mae_dx": 0.0011988531332463026,
      "mae_dy": 0.002403103979304433,
      "pose_mae_dtheta": 0.05874413251876831,
      "pose_mae_dx": 0.021343180909752846,
      "pose_mae_dy": 0.02877855859696865,
      "pose_rmse_dtheta": 0.1122659221291542,
      "pose_rmse_dx": 0.05735750496387482,
      "pose_rmse_dy": 0.06197134405374527,
      "pose_rmse_mean": 0.07719825953245163,
      "rmse_dtheta": 0.01990710198879242,
      "rmse_dx": 0.0032651792280375957,
      "rmse_dy": 0.00473198015242815,
      "rmse_mean": 0.00930142030119896,
      "rotation_flip": 0.0013463480863720179,
      "sparse_tokens": 32089.0,
      "step": 10172,
      "turn_loss": 0.08674509823322296,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.4726351979186025,
      "grad_norm": 0.600130558013916,
      "learning_rate": 5.729089528104981e-07,
      "loss": 0.1184,
      "mae_dtheta": 0.03471008315682411,
      "mae_dx": 0.014421112835407257,
      "mae_dy": 0.005977800581604242,
      "pose_mae_dtheta": 0.2854391932487488,
      "pose_mae_dx": 0.12239250540733337,
      "pose_mae_dy": 0.08425585180521011,
      "pose_rmse_dtheta": 0.48496463894844055,
      "pose_rmse_dx": 0.2516954839229584,
      "pose_rmse_dy": 0.19168584048748016,
      "pose_rmse_mean": 0.3094486594200134,
      "rmse_dtheta": 0.052261874079704285,
      "rmse_dx": 0.027483901008963585,
      "rmse_dy": 0.012600995600223541,
      "rmse_mean": 0.03078225813806057,
      "rotation_flip": 0.013994910754263401,
      "sparse_tokens": 14241.0,
      "step": 10173,
      "turn_loss": 0.2852994203567505,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.47268165768444526,
      "grad_norm": 0.38013505935668945,
      "learning_rate": 5.722945464835749e-07,
      "loss": 0.0978,
      "mae_dtheta": 0.007244786713272333,
      "mae_dx": 0.001675982610322535,
      "mae_dy": 0.0017387366387993097,
      "pose_mae_dtheta": 0.04796851798892021,
      "pose_mae_dx": 0.018949564546346664,
      "pose_mae_dy": 0.016083985567092896,
      "pose_rmse_dtheta": 0.1404760628938675,
      "pose_rmse_dx": 0.059535980224609375,
      "pose_rmse_dy": 0.03818023204803467,
      "pose_rmse_mean": 0.07939742505550385,
      "rmse_dtheta": 0.018783491104841232,
      "rmse_dx": 0.005861139390617609,
      "rmse_dy": 0.004491368308663368,
      "rmse_mean": 0.00971199944615364,
      "rotation_flip": 0.003225806402042508,
      "sparse_tokens": 32089.0,
      "step": 10174,
      "turn_loss": 0.05786110833287239,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47272811745028803,
      "grad_norm": 0.7544552683830261,
      "learning_rate": 5.716804497884698e-07,
      "loss": 0.2005,
      "mae_dtheta": 0.012486529536545277,
      "mae_dx": 0.0044372412376105785,
      "mae_dy": 0.0031065167859196663,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7544553279876709,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.55758666992188,
      "model/head/act_norm_mean": 102.66873816287878,
      "model/head/act_norm_min": 42.45372772216797,
      "model/head/act_over_embed": 70.55491806540093,
      "model/head/grad_frac": 0.11643748730421066,
      "model/head/grad_norm": 0.08784688264131546,
      "model/head/grad_zero_frac": 0.00015355953655671328,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7073025173611112,
      "model/head/update_ratio": 0.0014955053338781,
      "model/head/weight_delta": 9.957398414611816,
      "model/head/weight_delta_rel": 0.17468225955963135,
      "model/head/weight_norm": 58.7406005859375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.422829806804657,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42275802543879626,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226958751678467,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29052327300453307,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06026747450232506,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04546911641955376,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5393164938340808,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001468179514631629,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1500296592712402,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10292128473520279,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969724655151367,
      "model/modality_embedder/grad_frac": 0.06026747450232506,
      "model/modality_embedder/grad_norm": 0.04546911641955376,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5393164938340808,
      "model/modality_embedder/update_ratio": 0.001468179514631629,
      "model/modality_embedder/weight_delta": 3.1500296592712402,
      "model/modality_embedder/weight_delta_rel": 0.10292128473520279,
      "model/modality_embedder/weight_norm": 30.969724655151367,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.35216522216797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.93922107984608,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.032674789428711,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.764047486441582,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07624587416648865,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05752410367131233,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0020575516391545534,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.727053642272949,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09937547892332077,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.957550048828125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.13363647460938,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.87902837902838,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.390952110290527,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.409891861054216,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07714778184890747,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05820455774664879,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.00195545656606555,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4577696323394775,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11977984011173248,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.765201568603516,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.24603271484375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.662159792368126,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.547773361206055,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.635276462240597,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08136627078056335,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06138721480965614,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001997214276343584,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.745295286178589,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1257600039243698,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.736417770385742,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.80612182617188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.432316718775052,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.228443145751953,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.851744874537687,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09189361333847046,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0693296268582344,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002314796671271324,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2178988456726074,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1099725142121315,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.950632095336914,
      "model/normalizer/grad_frac": 0.3014419972896576,
      "model/normalizer/grad_norm": 0.2274245172739029,
      "model/normalizer/grad_zero_frac": 0.0001772607647581026,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002891543786972761,
      "model/normalizer/weight_delta": 6.770258903503418,
      "model/normalizer/weight_delta_rel": 0.08719701319932938,
      "model/normalizer/weight_norm": 78.6515884399414,
      "pose_mae_dtheta": 0.08791698515415192,
      "pose_mae_dx": 0.03842472285032272,
      "pose_mae_dy": 0.029072480276226997,
      "pose_rmse_dtheta": 0.2273125946521759,
      "pose_rmse_dx": 0.1032780185341835,
      "pose_rmse_dy": 0.0681334137916565,
      "pose_rmse_mean": 0.13290801644325256,
      "rmse_dtheta": 0.028888694941997528,
      "rmse_dx": 0.013379573822021484,
      "rmse_dy": 0.008005420677363873,
      "rmse_mean": 0.016757898032665253,
      "rotation_flip": 0.007933509536087513,
      "sparse_tokens": 32105.0,
      "step": 10175,
      "turn_loss": 0.18160712718963623,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.4727745772161308,
      "grad_norm": 0.4929008483886719,
      "learning_rate": 5.710666627681289e-07,
      "loss": 0.0772,
      "mae_dtheta": 0.029893867671489716,
      "mae_dx": 0.015597468242049217,
      "mae_dy": 0.007529604248702526,
      "pose_mae_dtheta": 0.22710052132606506,
      "pose_mae_dx": 0.115322545170784,
      "pose_mae_dy": 0.07830234616994858,
      "pose_rmse_dtheta": 0.32334432005882263,
      "pose_rmse_dx": 0.21255551278591156,
      "pose_rmse_dy": 0.13069003820419312,
      "pose_rmse_mean": 0.22219662368297577,
      "rmse_dtheta": 0.04172383248806,
      "rmse_dx": 0.027240201830863953,
      "rmse_dy": 0.014218599535524845,
      "rmse_mean": 0.02772754430770874,
      "rotation_flip": 0.023923445492982864,
      "sparse_tokens": 3742.0,
      "step": 10176,
      "turn_loss": 0.290885329246521,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.4728210369819736,
      "grad_norm": 1.1373203992843628,
      "learning_rate": 5.704531854654721e-07,
      "loss": 0.2302,
      "mae_dtheta": 0.030513927340507507,
      "mae_dx": 0.008193206042051315,
      "mae_dy": 0.002100852318108082,
      "pose_mae_dtheta": 0.2454034835100174,
      "pose_mae_dx": 0.06065714731812477,
      "pose_mae_dy": 0.01823784038424492,
      "pose_rmse_dtheta": 0.45926952362060547,
      "pose_rmse_dx": 0.16301828622817993,
      "pose_rmse_dy": 0.03967853635549545,
      "pose_rmse_mean": 0.2206554412841797,
      "rmse_dtheta": 0.05158470198512077,
      "rmse_dx": 0.01911276765167713,
      "rmse_dy": 0.00402041245251894,
      "rmse_mean": 0.024905962869524956,
      "rotation_flip": 0.004962779115885496,
      "sparse_tokens": 9058.0,
      "step": 10177,
      "turn_loss": 0.18046237528324127,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 32015.0,
      "epoch": 0.4728674967478164,
      "grad_norm": 0.8222218155860901,
      "learning_rate": 5.698400179234026e-07,
      "loss": 0.2857,
      "mae_dtheta": 0.028000056743621826,
      "mae_dx": 0.011134166270494461,
      "mae_dy": 0.0062633901834487915,
      "pose_mae_dtheta": 0.21198038756847382,
      "pose_mae_dx": 0.09434515982866287,
      "pose_mae_dy": 0.07722552120685577,
      "pose_rmse_dtheta": 0.39854711294174194,
      "pose_rmse_dx": 0.2108241319656372,
      "pose_rmse_dy": 0.17503270506858826,
      "pose_rmse_mean": 0.26146799325942993,
      "rmse_dtheta": 0.04578329250216484,
      "rmse_dx": 0.023834077641367912,
      "rmse_dy": 0.013503500260412693,
      "rmse_mean": 0.02770695649087429,
      "rotation_flip": 0.012743628583848476,
      "sparse_tokens": 26410.0,
      "step": 10178,
      "turn_loss": 0.2577369213104248,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4729139565136592,
      "grad_norm": 0.6556282639503479,
      "learning_rate": 5.692271601847976e-07,
      "loss": 0.1687,
      "mae_dtheta": 0.0059272171929478645,
      "mae_dx": 0.0016488863620907068,
      "mae_dy": 0.001578297233209014,
      "pose_mae_dtheta": 0.04247200861573219,
      "pose_mae_dx": 0.014178992249071598,
      "pose_mae_dy": 0.01402632612735033,
      "pose_rmse_dtheta": 0.12940678000450134,
      "pose_rmse_dx": 0.04399605095386505,
      "pose_rmse_dy": 0.040438394993543625,
      "pose_rmse_mean": 0.07128041237592697,
      "rmse_dtheta": 0.017069637775421143,
      "rmse_dx": 0.005537527147680521,
      "rmse_dy": 0.005326310638338327,
      "rmse_mean": 0.009311158210039139,
      "rotation_flip": 0.0070108347572386265,
      "sparse_tokens": 32089.0,
      "step": 10179,
      "turn_loss": 0.05254663527011871,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.47296041627950197,
      "grad_norm": 0.3804624378681183,
      "learning_rate": 5.686146122925151e-07,
      "loss": 0.1088,
      "mae_dtheta": 0.05484829843044281,
      "mae_dx": 0.0217023566365242,
      "mae_dy": 0.008683739230036736,
      "pose_mae_dtheta": 0.4752752184867859,
      "pose_mae_dx": 0.179571270942688,
      "pose_mae_dy": 0.10563324391841888,
      "pose_rmse_dtheta": 0.7335637211799622,
      "pose_rmse_dx": 0.33010977506637573,
      "pose_rmse_dy": 0.25467777252197266,
      "pose_rmse_mean": 0.4394504427909851,
      "rmse_dtheta": 0.0720922201871872,
      "rmse_dx": 0.03498738631606102,
      "rmse_dy": 0.0182274729013443,
      "rmse_mean": 0.04176902770996094,
      "rotation_flip": 0.00826446246355772,
      "sparse_tokens": 13819.0,
      "step": 10180,
      "turn_loss": 0.5173638463020325,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 28785.0,
      "epoch": 0.47300687604534475,
      "grad_norm": 0.5787572860717773,
      "learning_rate": 5.680023742893926e-07,
      "loss": 0.1482,
      "mae_dtheta": 0.03719842806458473,
      "mae_dx": 0.01415854599326849,
      "mae_dy": 0.004109981935471296,
      "pose_mae_dtheta": 0.29896894097328186,
      "pose_mae_dx": 0.11064989119768143,
      "pose_mae_dy": 0.05532627925276756,
      "pose_rmse_dtheta": 0.5187552571296692,
      "pose_rmse_dx": 0.23666508495807648,
      "pose_rmse_dy": 0.1463068276643753,
      "pose_rmse_mean": 0.30057573318481445,
      "rmse_dtheta": 0.05585639923810959,
      "rmse_dx": 0.02720394916832447,
      "rmse_dy": 0.008302327245473862,
      "rmse_mean": 0.030454223975539207,
      "rotation_flip": 0.017094017937779427,
      "sparse_tokens": 22242.0,
      "step": 10181,
      "turn_loss": 0.29371553659439087,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 36875.0,
      "epoch": 0.4730533358111875,
      "grad_norm": 0.595680832862854,
      "learning_rate": 5.673904462182417e-07,
      "loss": 0.2229,
      "mae_dtheta": 0.03767215460538864,
      "mae_dx": 0.013341829180717468,
      "mae_dy": 0.007395692635327578,
      "pose_mae_dtheta": 0.2726758122444153,
      "pose_mae_dx": 0.09845089912414551,
      "pose_mae_dy": 0.0748591423034668,
      "pose_rmse_dtheta": 0.5147461891174316,
      "pose_rmse_dx": 0.21585029363632202,
      "pose_rmse_dy": 0.17325200140476227,
      "pose_rmse_mean": 0.3012828230857849,
      "rmse_dtheta": 0.056949432939291,
      "rmse_dx": 0.025805462151765823,
      "rmse_dy": 0.015379032120108604,
      "rmse_mean": 0.03271131217479706,
      "rotation_flip": 0.01479289960116148,
      "sparse_tokens": 29675.0,
      "step": 10182,
      "turn_loss": 0.32644590735435486,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4730997955770303,
      "grad_norm": 0.3404214382171631,
      "learning_rate": 5.667788281218567e-07,
      "loss": 0.0755,
      "mae_dtheta": 0.010096504352986813,
      "mae_dx": 0.0017151717329397798,
      "mae_dy": 0.0016354345716536045,
      "pose_mae_dtheta": 0.06808166205883026,
      "pose_mae_dx": 0.01789601519703865,
      "pose_mae_dy": 0.020386485382914543,
      "pose_rmse_dtheta": 0.21577931940555573,
      "pose_rmse_dx": 0.03738952428102493,
      "pose_rmse_dy": 0.04589424654841423,
      "pose_rmse_mean": 0.09968769550323486,
      "rmse_dtheta": 0.025329113006591797,
      "rmse_dx": 0.004619442392140627,
      "rmse_dy": 0.003516053082421422,
      "rmse_mean": 0.011154869571328163,
      "rotation_flip": 0.0062333038076758385,
      "sparse_tokens": 32121.0,
      "step": 10183,
      "turn_loss": 0.09732036292552948,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.4731462553428731,
      "grad_norm": 1.2249189615249634,
      "learning_rate": 5.661675200430072e-07,
      "loss": 0.2603,
      "mae_dtheta": 0.04270042106509209,
      "mae_dx": 0.007021707016974688,
      "mae_dy": 0.004394917283207178,
      "pose_mae_dtheta": 0.34574925899505615,
      "pose_mae_dx": 0.07010431587696075,
      "pose_mae_dy": 0.04744331166148186,
      "pose_rmse_dtheta": 0.6138554811477661,
      "pose_rmse_dx": 0.19365070760250092,
      "pose_rmse_dy": 0.11873740702867508,
      "pose_rmse_mean": 0.30874788761138916,
      "rmse_dtheta": 0.06502450257539749,
      "rmse_dx": 0.018663698807358742,
      "rmse_dy": 0.010447753593325615,
      "rmse_mean": 0.03137865290045738,
      "rotation_flip": 0.003508772002533078,
      "sparse_tokens": 4564.0,
      "step": 10184,
      "turn_loss": 0.36490538716316223,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.47319271510871586,
      "grad_norm": 0.5680262446403503,
      "learning_rate": 5.655565220244425e-07,
      "loss": 0.1344,
      "mae_dtheta": 0.011687378399074078,
      "mae_dx": 0.0018221511272713542,
      "mae_dy": 0.00295294844545424,
      "pose_mae_dtheta": 0.0769212618470192,
      "pose_mae_dx": 0.0236321073025465,
      "pose_mae_dy": 0.031853459775447845,
      "pose_rmse_dtheta": 0.19212308526039124,
      "pose_rmse_dx": 0.07041247934103012,
      "pose_rmse_dy": 0.07068952918052673,
      "pose_rmse_mean": 0.1110750362277031,
      "rmse_dtheta": 0.023752206936478615,
      "rmse_dx": 0.0062133087776601315,
      "rmse_dy": 0.007190661039203405,
      "rmse_mean": 0.012385392561554909,
      "rotation_flip": 0.006119951140135527,
      "sparse_tokens": 32057.0,
      "step": 10185,
      "turn_loss": 0.09786780178546906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.47323917487455863,
      "grad_norm": 0.4952073395252228,
      "learning_rate": 5.649458341088915e-07,
      "loss": 0.1058,
      "mae_dtheta": 0.008433216251432896,
      "mae_dx": 0.0013726033503189683,
      "mae_dy": 0.0011029434390366077,
      "pose_mae_dtheta": 0.05478144437074661,
      "pose_mae_dx": 0.015147043392062187,
      "pose_mae_dy": 0.013609134592115879,
      "pose_rmse_dtheta": 0.18249094486236572,
      "pose_rmse_dx": 0.03990648314356804,
      "pose_rmse_dy": 0.032216984778642654,
      "pose_rmse_mean": 0.08487147092819214,
      "rmse_dtheta": 0.02336256206035614,
      "rmse_dx": 0.00411897012963891,
      "rmse_dy": 0.0023435240145772696,
      "rmse_mean": 0.009941685944795609,
      "rotation_flip": 0.0015243901871144772,
      "sparse_tokens": 32201.0,
      "step": 10186,
      "turn_loss": 0.0579361766576767,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.4732856346404014,
      "grad_norm": 0.7432302236557007,
      "learning_rate": 5.64335456339058e-07,
      "loss": 0.1305,
      "mae_dtheta": 0.042582105845212936,
      "mae_dx": 0.01329144649207592,
      "mae_dy": 0.00561648840084672,
      "pose_mae_dtheta": 0.390036940574646,
      "pose_mae_dx": 0.09398467093706131,
      "pose_mae_dy": 0.09100989997386932,
      "pose_rmse_dtheta": 0.6563026309013367,
      "pose_rmse_dx": 0.19012458622455597,
      "pose_rmse_dy": 0.17451512813568115,
      "pose_rmse_mean": 0.340314120054245,
      "rmse_dtheta": 0.06144333630800247,
      "rmse_dx": 0.025718044489622116,
      "rmse_dy": 0.010248585604131222,
      "rmse_mean": 0.032469987869262695,
      "rotation_flip": 0.01066666655242443,
      "sparse_tokens": 5771.0,
      "step": 10187,
      "turn_loss": 0.26571977138519287,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 19743.0,
      "epoch": 0.4733320944062442,
      "grad_norm": 0.548988938331604,
      "learning_rate": 5.637253887576271e-07,
      "loss": 0.1201,
      "mae_dtheta": 0.034102145582437515,
      "mae_dx": 0.010195671580731869,
      "mae_dy": 0.005199927370995283,
      "pose_mae_dtheta": 0.27128592133522034,
      "pose_mae_dx": 0.08066544681787491,
      "pose_mae_dy": 0.07672686874866486,
      "pose_rmse_dtheta": 0.5291919112205505,
      "pose_rmse_dx": 0.20099765062332153,
      "pose_rmse_dy": 0.20085352659225464,
      "pose_rmse_mean": 0.31034770607948303,
      "rmse_dtheta": 0.05399888753890991,
      "rmse_dx": 0.022220047190785408,
      "rmse_dy": 0.00983514729887247,
      "rmse_mean": 0.028684694319963455,
      "rotation_flip": 0.01033295039087534,
      "sparse_tokens": 15685.0,
      "step": 10188,
      "turn_loss": 0.21836121380329132,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.47337855417208696,
      "grad_norm": 0.6606251001358032,
      "learning_rate": 5.631156314072605e-07,
      "loss": 0.1342,
      "mae_dtheta": 0.02860182896256447,
      "mae_dx": 0.009153179824352264,
      "mae_dy": 0.003809687215834856,
      "pose_mae_dtheta": 0.21685726940631866,
      "pose_mae_dx": 0.07580068707466125,
      "pose_mae_dy": 0.036911044269800186,
      "pose_rmse_dtheta": 0.43070387840270996,
      "pose_rmse_dx": 0.18779301643371582,
      "pose_rmse_dy": 0.09485015273094177,
      "pose_rmse_mean": 0.23778235912322998,
      "rmse_dtheta": 0.0477018803358078,
      "rmse_dx": 0.020231930539011955,
      "rmse_dy": 0.0075934892520308495,
      "rmse_mean": 0.02517576888203621,
      "rotation_flip": 0.01182033121585846,
      "sparse_tokens": 7608.0,
      "step": 10189,
      "turn_loss": 0.2123061716556549,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47342501393792974,
      "grad_norm": 0.36732739210128784,
      "learning_rate": 5.625061843306001e-07,
      "loss": 0.0763,
      "mae_dtheta": 0.008281012065708637,
      "mae_dx": 0.0018925393233075738,
      "mae_dy": 0.0020424737595021725,
      "pose_mae_dtheta": 0.057697102427482605,
      "pose_mae_dx": 0.01967821642756462,
      "pose_mae_dy": 0.01802678592503071,
      "pose_rmse_dtheta": 0.16559186577796936,
      "pose_rmse_dx": 0.07969672232866287,
      "pose_rmse_dy": 0.049800973385572433,
      "pose_rmse_mean": 0.09836318343877792,
      "rmse_dtheta": 0.021244851872324944,
      "rmse_dx": 0.007479632738977671,
      "rmse_dy": 0.0055501083843410015,
      "rmse_mean": 0.011424864642322063,
      "rotation_flip": 0.004515599459409714,
      "sparse_tokens": 32105.0,
      "step": 10190,
      "turn_loss": 0.07669054716825485,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35688.0,
      "epoch": 0.4734714737037725,
      "grad_norm": 0.5170260071754456,
      "learning_rate": 5.618970475702629e-07,
      "loss": 0.1656,
      "mae_dtheta": 0.029939839616417885,
      "mae_dx": 0.011297138407826424,
      "mae_dy": 0.004687583073973656,
      "pose_mae_dtheta": 0.21633659303188324,
      "pose_mae_dx": 0.08763986825942993,
      "pose_mae_dy": 0.059720057994127274,
      "pose_rmse_dtheta": 0.39518770575523376,
      "pose_rmse_dx": 0.1967739760875702,
      "pose_rmse_dy": 0.13973279297351837,
      "pose_rmse_mean": 0.2438981533050537,
      "rmse_dtheta": 0.047428198158741,
      "rmse_dx": 0.023564457893371582,
      "rmse_dy": 0.00923896674066782,
      "rmse_mean": 0.026743873953819275,
      "rotation_flip": 0.012292562983930111,
      "sparse_tokens": 28603.0,
      "step": 10191,
      "turn_loss": 0.2305663824081421,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4735179334696153,
      "grad_norm": 0.4411158561706543,
      "learning_rate": 5.61288221168848e-07,
      "loss": 0.0799,
      "mae_dtheta": 0.00979757122695446,
      "mae_dx": 0.0015819865511730313,
      "mae_dy": 0.0024973677936941385,
      "pose_mae_dtheta": 0.07104473561048508,
      "pose_mae_dx": 0.02724112756550312,
      "pose_mae_dy": 0.03092166781425476,
      "pose_rmse_dtheta": 0.1753019094467163,
      "pose_rmse_dx": 0.0745331272482872,
      "pose_rmse_dy": 0.08508285880088806,
      "pose_rmse_mean": 0.11163930594921112,
      "rmse_dtheta": 0.020339269191026688,
      "rmse_dx": 0.0043253363110125065,
      "rmse_dy": 0.005723130889236927,
      "rmse_mean": 0.010129245929419994,
      "rotation_flip": 0.0016142049571499228,
      "sparse_tokens": 32073.0,
      "step": 10192,
      "turn_loss": 0.08147355169057846,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.47356439323545807,
      "grad_norm": 0.6359670162200928,
      "learning_rate": 5.606797051689294e-07,
      "loss": 0.1398,
      "mae_dtheta": 0.02774112857878208,
      "mae_dx": 0.012953384779393673,
      "mae_dy": 0.006553471088409424,
      "pose_mae_dtheta": 0.2420830875635147,
      "pose_mae_dx": 0.10119128227233887,
      "pose_mae_dy": 0.08167581260204315,
      "pose_rmse_dtheta": 0.3617607653141022,
      "pose_rmse_dx": 0.19873039424419403,
      "pose_rmse_dy": 0.17273294925689697,
      "pose_rmse_mean": 0.2444080412387848,
      "rmse_dtheta": 0.03974046930670738,
      "rmse_dx": 0.025577276945114136,
      "rmse_dy": 0.011181908659636974,
      "rmse_mean": 0.02549988590180874,
      "rotation_flip": 0.01595744676887989,
      "sparse_tokens": 6415.0,
      "step": 10193,
      "turn_loss": 0.3207015097141266,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.47361085300130085,
      "grad_norm": 0.5120624303817749,
      "learning_rate": 5.60071499613063e-07,
      "loss": 0.0989,
      "mae_dtheta": 0.04251018911600113,
      "mae_dx": 0.009748888202011585,
      "mae_dy": 0.005185956601053476,
      "pose_mae_dtheta": 0.30236420035362244,
      "pose_mae_dx": 0.06738554686307907,
      "pose_mae_dy": 0.06682514399290085,
      "pose_rmse_dtheta": 0.5832213759422302,
      "pose_rmse_dx": 0.16868889331817627,
      "pose_rmse_dy": 0.156744584441185,
      "pose_rmse_mean": 0.302884966135025,
      "rmse_dtheta": 0.0636989027261734,
      "rmse_dx": 0.02272767946124077,
      "rmse_dy": 0.010596878826618195,
      "rmse_mean": 0.03234115615487099,
      "rotation_flip": 0.01243339292705059,
      "sparse_tokens": 8685.0,
      "step": 10194,
      "turn_loss": 0.25293412804603577,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4736573127671437,
      "grad_norm": 0.464834600687027,
      "learning_rate": 5.594636045437796e-07,
      "loss": 0.1066,
      "mae_dtheta": 0.010213099420070648,
      "mae_dx": 0.001500162179581821,
      "mae_dy": 0.0022333988454192877,
      "pose_mae_dtheta": 0.07022905349731445,
      "pose_mae_dx": 0.024720516055822372,
      "pose_mae_dy": 0.030400652438402176,
      "pose_rmse_dtheta": 0.1776706725358963,
      "pose_rmse_dx": 0.06418871134519577,
      "pose_rmse_dy": 0.07139468193054199,
      "pose_rmse_mean": 0.10441802442073822,
      "rmse_dtheta": 0.023207759484648705,
      "rmse_dx": 0.005183911882340908,
      "rmse_dy": 0.004517014138400555,
      "rmse_mean": 0.010969562456011772,
      "rotation_flip": 0.003629032289609313,
      "sparse_tokens": 32057.0,
      "step": 10195,
      "turn_loss": 0.08348362892866135,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.47370377253298646,
      "grad_norm": 0.9045892357826233,
      "learning_rate": 5.588560200035886e-07,
      "loss": 0.2463,
      "mae_dtheta": 0.03334956616163254,
      "mae_dx": 0.009017987176775932,
      "mae_dy": 0.004026087466627359,
      "pose_mae_dtheta": 0.22688144445419312,
      "pose_mae_dx": 0.07154347002506256,
      "pose_mae_dy": 0.04482884705066681,
      "pose_rmse_dtheta": 0.3799270987510681,
      "pose_rmse_dx": 0.18733328580856323,
      "pose_rmse_dy": 0.09714201837778091,
      "pose_rmse_mean": 0.22146748006343842,
      "rmse_dtheta": 0.05005848780274391,
      "rmse_dx": 0.02130759134888649,
      "rmse_dy": 0.007390861865133047,
      "rmse_mean": 0.02625231444835663,
      "rotation_flip": 0.016317015513777733,
      "sparse_tokens": 13036.0,
      "step": 10196,
      "turn_loss": 0.24226589500904083,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.47375023229882923,
      "grad_norm": 0.5026946663856506,
      "learning_rate": 5.582487460349806e-07,
      "loss": 0.1393,
      "mae_dtheta": 0.02593069151043892,
      "mae_dx": 0.010541660711169243,
      "mae_dy": 0.008965677581727505,
      "pose_mae_dtheta": 0.1725376695394516,
      "pose_mae_dx": 0.07572406530380249,
      "pose_mae_dy": 0.08178410679101944,
      "pose_rmse_dtheta": 0.27506116032600403,
      "pose_rmse_dx": 0.21019776165485382,
      "pose_rmse_dy": 0.1868097335100174,
      "pose_rmse_mean": 0.22402289509773254,
      "rmse_dtheta": 0.040178682655096054,
      "rmse_dx": 0.02331731840968132,
      "rmse_dy": 0.018586307764053345,
      "rmse_mean": 0.027360770851373672,
      "rotation_flip": 0.013937282375991344,
      "sparse_tokens": 5530.0,
      "step": 10197,
      "turn_loss": 0.2923017740249634,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.473796692064672,
      "grad_norm": 0.49012306332588196,
      "learning_rate": 5.576417826804209e-07,
      "loss": 0.1035,
      "mae_dtheta": 0.010870532132685184,
      "mae_dx": 0.0026425174437463284,
      "mae_dy": 0.0019468291429802775,
      "pose_mae_dtheta": 0.07258950918912888,
      "pose_mae_dx": 0.027992581948637962,
      "pose_mae_dy": 0.02776552364230156,
      "pose_rmse_dtheta": 0.19439025223255157,
      "pose_rmse_dx": 0.0688924565911293,
      "pose_rmse_dy": 0.07587359845638275,
      "pose_rmse_mean": 0.1130521148443222,
      "rmse_dtheta": 0.026781875640153885,
      "rmse_dx": 0.007560664787888527,
      "rmse_dy": 0.00424504978582263,
      "rmse_mean": 0.01286253146827221,
      "rotation_flip": 0.0038443056400865316,
      "sparse_tokens": 32121.0,
      "step": 10198,
      "turn_loss": 0.1106024980545044,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.4738431518305148,
      "grad_norm": 0.5808907747268677,
      "learning_rate": 5.570351299823562e-07,
      "loss": 0.1799,
      "mae_dtheta": 0.04520087316632271,
      "mae_dx": 0.020972872152924538,
      "mae_dy": 0.004733484238386154,
      "pose_mae_dtheta": 0.3746952712535858,
      "pose_mae_dx": 0.18154014647006989,
      "pose_mae_dy": 0.05862882733345032,
      "pose_rmse_dtheta": 0.5694061517715454,
      "pose_rmse_dx": 0.34986570477485657,
      "pose_rmse_dy": 0.14575231075286865,
      "pose_rmse_mean": 0.355008065700531,
      "rmse_dtheta": 0.0609237477183342,
      "rmse_dx": 0.034305140376091,
      "rmse_dy": 0.009806398302316666,
      "rmse_mean": 0.035011764615774155,
      "rotation_flip": 0.00917431153357029,
      "sparse_tokens": 10986.0,
      "step": 10199,
      "turn_loss": 0.3234519958496094,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47388961159635756,
      "grad_norm": 0.49648815393447876,
      "learning_rate": 5.564287879832103e-07,
      "loss": 0.0962,
      "mae_dtheta": 0.010762451216578484,
      "mae_dx": 0.0018005215097218752,
      "mae_dy": 0.003150303615257144,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.49648818373680115,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.97540283203125,
      "model/head/act_norm_mean": 104.3903290719697,
      "model/head/act_norm_min": 57.89342498779297,
      "model/head/act_over_embed": 71.73801145591624,
      "model/head/grad_frac": 0.08383543789386749,
      "model/head/grad_norm": 0.041623305529356,
      "model/head/grad_zero_frac": 0.00020495755597949028,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7063802083333334,
      "model/head/update_ratio": 0.0007085924735292792,
      "model/head/weight_delta": 9.958539962768555,
      "model/head/weight_delta_rel": 0.17470228672027588,
      "model/head/weight_norm": 58.74082565307617,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42284268140792847,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42274824065477856,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42268434166908264,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29051654880934946,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07679908722639084,
      "model/modality_embedder.encoders.pose/grad_norm": 0.038129840046167374,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5426709641255605,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012311969185248017,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1503114700317383,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10293049365282059,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96973419189453,
      "model/modality_embedder/grad_frac": 0.07679908722639084,
      "model/modality_embedder/grad_norm": 0.038129840046167374,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5426709641255605,
      "model/modality_embedder/update_ratio": 0.0012311969185248017,
      "model/modality_embedder/weight_delta": 3.1503114700317383,
      "model/modality_embedder/weight_delta_rel": 0.10293049365282059,
      "model/modality_embedder/weight_norm": 30.96973419189453,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.94981384277344,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.107606321147987,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.08342456817627,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.879763400711717,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.04754457622766495,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02360532060265541,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003429632051847875,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008443216211162508,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7276394367218018,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09939682483673096,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.957735061645508,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.50017547607422,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.061269941478276,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.05924129486084,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.535129968942172,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05078680440783501,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02521504834294319,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008471235050819814,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4586265087127686,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11980952322483063,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.765493392944336,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 86.42975616455078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.90989508177008,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.246343612670898,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.805522472451944,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05752679705619812,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02856137417256832,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009292272152379155,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.746250629425049,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12579208612442017,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.736696243286133,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 87.20174407958984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.686811067019402,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.854948043823242,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.026635773264832,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06840020418167114,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03395989164710045,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011338548501953483,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.218693494796753,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.10999967157840729,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95082664489746,
      "model/normalizer/grad_frac": 0.25709107518196106,
      "model/normalizer/grad_norm": 0.1276426762342453,
      "model/normalizer/grad_zero_frac": 0.00024225637025665492,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016228806925937533,
      "model/normalizer/weight_delta": 6.771917343139648,
      "model/normalizer/weight_delta_rel": 0.08721837401390076,
      "model/normalizer/weight_norm": 78.65191650390625,
      "pose_mae_dtheta": 0.06561408191919327,
      "pose_mae_dx": 0.024515103548765182,
      "pose_mae_dy": 0.029632417485117912,
      "pose_rmse_dtheta": 0.14647367596626282,
      "pose_rmse_dx": 0.06368979066610336,
      "pose_rmse_dy": 0.06002335622906685,
      "pose_rmse_mean": 0.09006228297948837,
      "rmse_dtheta": 0.023123526945710182,
      "rmse_dx": 0.004874825477600098,
      "rmse_dy": 0.006738798227161169,
      "rmse_mean": 0.011579050682485104,
      "rotation_flip": 0.007171029224991798,
      "sparse_tokens": 32105.0,
      "step": 10200,
      "turn_loss": 0.08852850645780563,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.47388961159635756,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.29963305592536926,
      "eval_objectnav_nopose_mae_dtheta": 0.04014522209763527,
      "eval_objectnav_nopose_mae_dx": 0.012636068277060986,
      "eval_objectnav_nopose_mae_dy": 0.004803335759788752,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32287436723709106,
      "eval_objectnav_nopose_pose_mae_dx": 0.10089781880378723,
      "eval_objectnav_nopose_pose_mae_dy": 0.05377105250954628,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5452709794044495,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22510926425457,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12668798863887787,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29902276396751404,
      "eval_objectnav_nopose_rmse_dtheta": 0.05807029455900192,
      "eval_objectnav_nopose_rmse_dx": 0.02508641965687275,
      "eval_objectnav_nopose_rmse_dy": 0.009897848591208458,
      "eval_objectnav_nopose_rmse_mean": 0.03101818822324276,
      "eval_objectnav_nopose_rotation_flip": 0.015375226736068726,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.29963305592536926,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 10200
    },
    {
      "epoch": 0.47388961159635756,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2682543694972992,
      "eval_objectnav_pose_mae_dtheta": 0.03541720286011696,
      "eval_objectnav_pose_mae_dx": 0.010884535498917103,
      "eval_objectnav_pose_mae_dy": 0.00439109094440937,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26515498757362366,
      "eval_objectnav_pose_pose_mae_dx": 0.08532088249921799,
      "eval_objectnav_pose_pose_mae_dy": 0.04652337357401848,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46970775723457336,
      "eval_objectnav_pose_pose_rmse_dx": 0.19696196913719177,
      "eval_objectnav_pose_pose_rmse_dy": 0.11174772679805756,
      "eval_objectnav_pose_pose_rmse_mean": 0.25947248935699463,
      "eval_objectnav_pose_rmse_dtheta": 0.053597111254930496,
      "eval_objectnav_pose_rmse_dx": 0.022885112091898918,
      "eval_objectnav_pose_rmse_dy": 0.009081821888685226,
      "eval_objectnav_pose_rmse_mean": 0.028521349653601646,
      "eval_objectnav_pose_rotation_flip": 0.015007836744189262,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2682543694972992,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 10200
    },
    {
      "epoch": 0.47388961159635756,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08720160275697708,
      "eval_pointnav_mae_dtheta": 0.010058946907520294,
      "eval_pointnav_mae_dx": 0.002186161233112216,
      "eval_pointnav_mae_dy": 0.0022827754728496075,
      "eval_pointnav_pose_mae_dtheta": 0.06849826872348785,
      "eval_pointnav_pose_mae_dx": 0.024361999705433846,
      "eval_pointnav_pose_mae_dy": 0.024180475622415543,
      "eval_pointnav_pose_rmse_dtheta": 0.1985815167427063,
      "eval_pointnav_pose_rmse_dx": 0.07557941228151321,
      "eval_pointnav_pose_rmse_dy": 0.06832224875688553,
      "eval_pointnav_pose_rmse_mean": 0.11416105926036835,
      "eval_pointnav_rmse_dtheta": 0.02511676587164402,
      "eval_pointnav_rmse_dx": 0.00709297601133585,
      "eval_pointnav_rmse_dy": 0.006086439359933138,
      "eval_pointnav_rmse_mean": 0.012765394523739815,
      "eval_pointnav_rotation_flip": 0.005524462554603815,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08720160275697708,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 10200
    },
    {
      "epoch": 0.47388961159635756,
      "eval_loss": 0.21836300939321518,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.29963305592536926,
      "eval_objectnav_nopose_mae_dtheta": 0.04014522209763527,
      "eval_objectnav_nopose_mae_dx": 0.012636068277060986,
      "eval_objectnav_nopose_mae_dy": 0.004803335759788752,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32287436723709106,
      "eval_objectnav_nopose_pose_mae_dx": 0.10089781880378723,
      "eval_objectnav_nopose_pose_mae_dy": 0.05377105250954628,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5452709794044495,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22510926425457,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12668798863887787,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29902276396751404,
      "eval_objectnav_nopose_rmse_dtheta": 0.05807029455900192,
      "eval_objectnav_nopose_rmse_dx": 0.02508641965687275,
      "eval_objectnav_nopose_rmse_dy": 0.009897848591208458,
      "eval_objectnav_nopose_rmse_mean": 0.03101818822324276,
      "eval_objectnav_nopose_rotation_flip": 0.015375226736068726,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.29963305592536926,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2682543694972992,
      "eval_objectnav_pose_mae_dtheta": 0.03541720286011696,
      "eval_objectnav_pose_mae_dx": 0.010884535498917103,
      "eval_objectnav_pose_mae_dy": 0.00439109094440937,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26515498757362366,
      "eval_objectnav_pose_pose_mae_dx": 0.08532088249921799,
      "eval_objectnav_pose_pose_mae_dy": 0.04652337357401848,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46970775723457336,
      "eval_objectnav_pose_pose_rmse_dx": 0.19696196913719177,
      "eval_objectnav_pose_pose_rmse_dy": 0.11174772679805756,
      "eval_objectnav_pose_pose_rmse_mean": 0.25947248935699463,
      "eval_objectnav_pose_rmse_dtheta": 0.053597111254930496,
      "eval_objectnav_pose_rmse_dx": 0.022885112091898918,
      "eval_objectnav_pose_rmse_dy": 0.009081821888685226,
      "eval_objectnav_pose_rmse_mean": 0.028521349653601646,
      "eval_objectnav_pose_rotation_flip": 0.015007836744189262,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2682543694972992,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08720160275697708,
      "eval_pointnav_mae_dtheta": 0.010058946907520294,
      "eval_pointnav_mae_dx": 0.002186161233112216,
      "eval_pointnav_mae_dy": 0.0022827754728496075,
      "eval_pointnav_pose_mae_dtheta": 0.06849826872348785,
      "eval_pointnav_pose_mae_dx": 0.024361999705433846,
      "eval_pointnav_pose_mae_dy": 0.024180475622415543,
      "eval_pointnav_pose_rmse_dtheta": 0.1985815167427063,
      "eval_pointnav_pose_rmse_dx": 0.07557941228151321,
      "eval_pointnav_pose_rmse_dy": 0.06832224875688553,
      "eval_pointnav_pose_rmse_mean": 0.11416105926036835,
      "eval_pointnav_rmse_dtheta": 0.02511676587164402,
      "eval_pointnav_rmse_dx": 0.00709297601133585,
      "eval_pointnav_rmse_dy": 0.006086439359933138,
      "eval_pointnav_rmse_mean": 0.012765394523739815,
      "eval_pointnav_rotation_flip": 0.005524462554603815,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08720160275697708,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 10200
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.47393607136220034,
      "grad_norm": 1.0325818061828613,
      "learning_rate": 5.558227567253832e-07,
      "loss": 0.2968,
      "mae_dtheta": 0.018755072727799416,
      "mae_dx": 0.002335163066163659,
      "mae_dy": 0.004767606500536203,
      "pose_mae_dtheta": 0.11600698530673981,
      "pose_mae_dx": 0.03174896165728569,
      "pose_mae_dy": 0.055030014365911484,
      "pose_rmse_dtheta": 0.20192928612232208,
      "pose_rmse_dx": 0.07205133885145187,
      "pose_rmse_dy": 0.1242954209446907,
      "pose_rmse_mean": 0.13275867700576782,
      "rmse_dtheta": 0.03354399651288986,
      "rmse_dx": 0.006118907127529383,
      "rmse_dy": 0.008998841047286987,
      "rmse_mean": 0.016220582649111748,
      "rotation_flip": 0.013761468231678009,
      "sparse_tokens": 4243.0,
      "step": 10201,
      "turn_loss": 0.16008460521697998,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.4739825311280431,
      "grad_norm": 0.45429593324661255,
      "learning_rate": 5.552170362512571e-07,
      "loss": 0.0884,
      "mae_dtheta": 0.0283034835010767,
      "mae_dx": 0.009446583688259125,
      "mae_dy": 0.0028631354216486216,
      "pose_mae_dtheta": 0.19922667741775513,
      "pose_mae_dx": 0.0870717391371727,
      "pose_mae_dy": 0.027819307520985603,
      "pose_rmse_dtheta": 0.38648852705955505,
      "pose_rmse_dx": 0.19655248522758484,
      "pose_rmse_dy": 0.05275395140051842,
      "pose_rmse_mean": 0.21193164587020874,
      "rmse_dtheta": 0.0464877225458622,
      "rmse_dx": 0.020631680265069008,
      "rmse_dy": 0.005568512715399265,
      "rmse_mean": 0.02422930672764778,
      "rotation_flip": 0.00501253129914403,
      "sparse_tokens": 6566.0,
      "step": 10202,
      "turn_loss": 0.21518780291080475,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.4740289908938859,
      "grad_norm": 0.8131207227706909,
      "learning_rate": 5.546116266031881e-07,
      "loss": 0.2462,
      "mae_dtheta": 0.025978369638323784,
      "mae_dx": 0.011243902146816254,
      "mae_dy": 0.005076062865555286,
      "pose_mae_dtheta": 0.19256655871868134,
      "pose_mae_dx": 0.10871473699808121,
      "pose_mae_dy": 0.07004613429307938,
      "pose_rmse_dtheta": 0.33140653371810913,
      "pose_rmse_dx": 0.25373411178588867,
      "pose_rmse_dy": 0.1388440877199173,
      "pose_rmse_mean": 0.24132823944091797,
      "rmse_dtheta": 0.03943055495619774,
      "rmse_dx": 0.024251943454146385,
      "rmse_dy": 0.008389870636165142,
      "rmse_mean": 0.024024121463298798,
      "rotation_flip": 0.00958466436713934,
      "sparse_tokens": 5627.0,
      "step": 10203,
      "turn_loss": 0.20013868808746338,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47407545065972867,
      "grad_norm": 0.5206290483474731,
      "learning_rate": 5.540065278235141e-07,
      "loss": 0.0888,
      "mae_dtheta": 0.009357876144349575,
      "mae_dx": 0.001247750362381339,
      "mae_dy": 0.0017950027249753475,
      "pose_mae_dtheta": 0.06517555564641953,
      "pose_mae_dx": 0.011466845870018005,
      "pose_mae_dy": 0.02059726044535637,
      "pose_rmse_dtheta": 0.2247217297554016,
      "pose_rmse_dx": 0.028980113565921783,
      "pose_rmse_dy": 0.05414411053061485,
      "pose_rmse_mean": 0.10261531919240952,
      "rmse_dtheta": 0.026118174195289612,
      "rmse_dx": 0.004283884074538946,
      "rmse_dy": 0.005944953765720129,
      "rmse_mean": 0.012115671299397945,
      "rotation_flip": 0.0031014620326459408,
      "sparse_tokens": 32105.0,
      "step": 10204,
      "turn_loss": 0.06465435028076172,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47412191042557145,
      "grad_norm": 0.4452976584434509,
      "learning_rate": 5.53401739954551e-07,
      "loss": 0.106,
      "mae_dtheta": 0.011123770847916603,
      "mae_dx": 0.001642489107325673,
      "mae_dy": 0.002615945413708687,
      "pose_mae_dtheta": 0.06472193449735641,
      "pose_mae_dx": 0.020197326317429543,
      "pose_mae_dy": 0.022319886833429337,
      "pose_rmse_dtheta": 0.1734974980354309,
      "pose_rmse_dx": 0.05233406275510788,
      "pose_rmse_dy": 0.049391381442546844,
      "pose_rmse_mean": 0.09174098819494247,
      "rmse_dtheta": 0.024515826255083084,
      "rmse_dx": 0.0047045485116541386,
      "rmse_dy": 0.006139845587313175,
      "rmse_mean": 0.011786740273237228,
      "rotation_flip": 0.003358209040015936,
      "sparse_tokens": 32121.0,
      "step": 10205,
      "turn_loss": 0.09959795325994492,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4741683701914142,
      "grad_norm": 0.5572330951690674,
      "learning_rate": 5.527972630385897e-07,
      "loss": 0.1146,
      "mae_dtheta": 0.010850963182747364,
      "mae_dx": 0.0020506775472313166,
      "mae_dy": 0.002905460773035884,
      "pose_mae_dtheta": 0.07289759069681168,
      "pose_mae_dx": 0.022609073668718338,
      "pose_mae_dy": 0.02943672239780426,
      "pose_rmse_dtheta": 0.1525086760520935,
      "pose_rmse_dx": 0.06038270518183708,
      "pose_rmse_dy": 0.07188768684864044,
      "pose_rmse_mean": 0.09492635726928711,
      "rmse_dtheta": 0.02129438705742359,
      "rmse_dx": 0.00619718199595809,
      "rmse_dy": 0.006342458073049784,
      "rmse_mean": 0.011278009973466396,
      "rotation_flip": 0.00862366333603859,
      "sparse_tokens": 32121.0,
      "step": 10206,
      "turn_loss": 0.09644059091806412,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.474214829957257,
      "grad_norm": 0.5056254863739014,
      "learning_rate": 5.521930971179041e-07,
      "loss": 0.084,
      "mae_dtheta": 0.03691108524799347,
      "mae_dx": 0.012702158652245998,
      "mae_dy": 0.011663801968097687,
      "pose_mae_dtheta": 0.2810220420360565,
      "pose_mae_dx": 0.1093183383345604,
      "pose_mae_dy": 0.1344761997461319,
      "pose_rmse_dtheta": 0.42754194140434265,
      "pose_rmse_dx": 0.21432988345623016,
      "pose_rmse_dy": 0.3129280209541321,
      "pose_rmse_mean": 0.3182666301727295,
      "rmse_dtheta": 0.05167354270815849,
      "rmse_dx": 0.022434329614043236,
      "rmse_dy": 0.023790357634425163,
      "rmse_mean": 0.032632745802402496,
      "rotation_flip": 0.015555555932223797,
      "sparse_tokens": 8216.0,
      "step": 10207,
      "turn_loss": 0.34126871824264526,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4742612897230998,
      "grad_norm": 0.31098949909210205,
      "learning_rate": 5.515892422347413e-07,
      "loss": 0.075,
      "mae_dtheta": 0.006855877581983805,
      "mae_dx": 0.0011226148344576359,
      "mae_dy": 0.0020149173215031624,
      "pose_mae_dtheta": 0.05010116100311279,
      "pose_mae_dx": 0.019566068425774574,
      "pose_mae_dy": 0.027423696592450142,
      "pose_rmse_dtheta": 0.11173970252275467,
      "pose_rmse_dx": 0.06055426597595215,
      "pose_rmse_dy": 0.07550587505102158,
      "pose_rmse_mean": 0.0825999528169632,
      "rmse_dtheta": 0.015637215226888657,
      "rmse_dx": 0.003610386047512293,
      "rmse_dy": 0.005339920986443758,
      "rmse_mean": 0.008195840753614902,
      "rotation_flip": 0.004540867637842894,
      "sparse_tokens": 32041.0,
      "step": 10208,
      "turn_loss": 0.05985075235366821,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.47430774948894255,
      "grad_norm": 0.8434922695159912,
      "learning_rate": 5.509856984313316e-07,
      "loss": 0.1811,
      "mae_dtheta": 0.030556362122297287,
      "mae_dx": 0.01483275555074215,
      "mae_dy": 0.008077078498899937,
      "pose_mae_dtheta": 0.2681378126144409,
      "pose_mae_dx": 0.13104623556137085,
      "pose_mae_dy": 0.11575605720281601,
      "pose_rmse_dtheta": 0.4284168779850006,
      "pose_rmse_dx": 0.29254454374313354,
      "pose_rmse_dy": 0.21835161745548248,
      "pose_rmse_mean": 0.3131043612957001,
      "rmse_dtheta": 0.04385054484009743,
      "rmse_dx": 0.029281696304678917,
      "rmse_dy": 0.013207360170781612,
      "rmse_mean": 0.02877986803650856,
      "rotation_flip": 0.01577909290790558,
      "sparse_tokens": 10350.0,
      "step": 10209,
      "turn_loss": 0.29211053252220154,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 2624.0,
      "epoch": 0.47435420925478533,
      "grad_norm": 0.5961751341819763,
      "learning_rate": 5.503824657498786e-07,
      "loss": 0.152,
      "mae_dtheta": 0.06175101548433304,
      "mae_dx": 0.007852102629840374,
      "mae_dy": 0.005214817821979523,
      "pose_mae_dtheta": 0.5149890184402466,
      "pose_mae_dx": 0.048227932304143906,
      "pose_mae_dy": 0.07737710326910019,
      "pose_rmse_dtheta": 0.7686648964881897,
      "pose_rmse_dx": 0.1068178191781044,
      "pose_rmse_dy": 0.206912562251091,
      "pose_rmse_mean": 0.3607984483242035,
      "rmse_dtheta": 0.07997613400220871,
      "rmse_dx": 0.01691930927336216,
      "rmse_dy": 0.01214112713932991,
      "rmse_mean": 0.03634552285075188,
      "rotation_flip": 0.014084506779909134,
      "sparse_tokens": 2269.0,
      "step": 10210,
      "turn_loss": 0.3920520544052124,
      "turns": 8.0,
      "turns_per_sample": 8.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.47440066902062816,
      "grad_norm": 0.4198344349861145,
      "learning_rate": 5.497795442325682e-07,
      "loss": 0.1338,
      "mae_dtheta": 0.007386896759271622,
      "mae_dx": 0.0012511699460446835,
      "mae_dy": 0.0016628664452582598,
      "pose_mae_dtheta": 0.049756813794374466,
      "pose_mae_dx": 0.009303726255893707,
      "pose_mae_dy": 0.017420802265405655,
      "pose_rmse_dtheta": 0.14152950048446655,
      "pose_rmse_dx": 0.02090860903263092,
      "pose_rmse_dy": 0.03810235857963562,
      "pose_rmse_mean": 0.0668468251824379,
      "rmse_dtheta": 0.018109280616044998,
      "rmse_dx": 0.004931220784783363,
      "rmse_dy": 0.005899782758206129,
      "rmse_mean": 0.009646762162446976,
      "rotation_flip": 0.005875440780073404,
      "sparse_tokens": 32137.0,
      "step": 10211,
      "turn_loss": 0.06006517633795738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11344.0,
      "epoch": 0.47444712878647094,
      "grad_norm": 0.720109760761261,
      "learning_rate": 5.491769339215642e-07,
      "loss": 0.2001,
      "mae_dtheta": 0.0328117273747921,
      "mae_dx": 0.0072519201785326,
      "mae_dy": 0.004401559941470623,
      "pose_mae_dtheta": 0.23842492699623108,
      "pose_mae_dx": 0.06225264444947243,
      "pose_mae_dy": 0.07693788409233093,
      "pose_rmse_dtheta": 0.4082548916339874,
      "pose_rmse_dx": 0.1570902317762375,
      "pose_rmse_dy": 0.17814089357852936,
      "pose_rmse_mean": 0.2478286623954773,
      "rmse_dtheta": 0.049939099699258804,
      "rmse_dx": 0.01878948137164116,
      "rmse_dy": 0.008060187101364136,
      "rmse_mean": 0.0255962572991848,
      "rotation_flip": 0.015810277312994003,
      "sparse_tokens": 9474.0,
      "step": 10212,
      "turn_loss": 0.20066507160663605,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4744935885523137,
      "grad_norm": 0.6424564719200134,
      "learning_rate": 5.485746348590048e-07,
      "loss": 0.1236,
      "mae_dtheta": 0.008720883168280125,
      "mae_dx": 0.002507477533072233,
      "mae_dy": 0.0007221339037641883,
      "pose_mae_dtheta": 0.056865010410547256,
      "pose_mae_dx": 0.02265959419310093,
      "pose_mae_dy": 0.0109488470479846,
      "pose_rmse_dtheta": 0.2207418829202652,
      "pose_rmse_dx": 0.05522485077381134,
      "pose_rmse_dy": 0.037302806973457336,
      "pose_rmse_mean": 0.10442318767309189,
      "rmse_dtheta": 0.02914922870695591,
      "rmse_dx": 0.007275379728525877,
      "rmse_dy": 0.001895874971523881,
      "rmse_mean": 0.012773494236171246,
      "rotation_flip": 0.001033057807944715,
      "sparse_tokens": 32185.0,
      "step": 10213,
      "turn_loss": 0.08917475491762161,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4745400483181565,
      "grad_norm": 0.47031304240226746,
      "learning_rate": 5.479726470870111e-07,
      "loss": 0.0948,
      "mae_dtheta": 0.012736991979181767,
      "mae_dx": 0.0020941002294421196,
      "mae_dy": 0.003748935414478183,
      "pose_mae_dtheta": 0.08395954221487045,
      "pose_mae_dx": 0.029395677149295807,
      "pose_mae_dy": 0.03824435919523239,
      "pose_rmse_dtheta": 0.19063334167003632,
      "pose_rmse_dx": 0.07346969097852707,
      "pose_rmse_dy": 0.10637710988521576,
      "pose_rmse_mean": 0.12349337339401245,
      "rmse_dtheta": 0.024579497054219246,
      "rmse_dx": 0.005157222971320152,
      "rmse_dy": 0.007885513827204704,
      "rmse_mean": 0.012540745548903942,
      "rotation_flip": 0.010600706562399864,
      "sparse_tokens": 32153.0,
      "step": 10214,
      "turn_loss": 0.10953882336616516,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47458650808399927,
      "grad_norm": 0.5734481811523438,
      "learning_rate": 5.473709706476793e-07,
      "loss": 0.0798,
      "mae_dtheta": 0.00845433957874775,
      "mae_dx": 0.0018744090339168906,
      "mae_dy": 0.002576148137450218,
      "pose_mae_dtheta": 0.05218222737312317,
      "pose_mae_dx": 0.0232609324157238,
      "pose_mae_dy": 0.025735462084412575,
      "pose_rmse_dtheta": 0.10489165037870407,
      "pose_rmse_dx": 0.060535039752721786,
      "pose_rmse_dy": 0.0566515251994133,
      "pose_rmse_mean": 0.07402607053518295,
      "rmse_dtheta": 0.016964105889201164,
      "rmse_dx": 0.005720107350498438,
      "rmse_dy": 0.006065627560019493,
      "rmse_mean": 0.00958328042179346,
      "rotation_flip": 0.0028794733807444572,
      "sparse_tokens": 32105.0,
      "step": 10215,
      "turn_loss": 0.07792527228593826,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.47463296784984205,
      "grad_norm": 0.5959459543228149,
      "learning_rate": 5.467696055830862e-07,
      "loss": 0.0995,
      "mae_dtheta": 0.007338850758969784,
      "mae_dx": 0.0011783309746533632,
      "mae_dy": 0.0012946706265211105,
      "pose_mae_dtheta": 0.04415450245141983,
      "pose_mae_dx": 0.015140863135457039,
      "pose_mae_dy": 0.017523767426609993,
      "pose_rmse_dtheta": 0.11626579612493515,
      "pose_rmse_dx": 0.04253723844885826,
      "pose_rmse_dy": 0.039058126509189606,
      "pose_rmse_mean": 0.06595372408628464,
      "rmse_dtheta": 0.01860395446419716,
      "rmse_dx": 0.00442545348778367,
      "rmse_dy": 0.002548756543546915,
      "rmse_mean": 0.00852605514228344,
      "rotation_flip": 0.001689902856014669,
      "sparse_tokens": 32089.0,
      "step": 10216,
      "turn_loss": 0.056566618382930756,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2309.0,
      "epoch": 0.4746794276156848,
      "grad_norm": 1.152075171470642,
      "learning_rate": 5.461685519352838e-07,
      "loss": 0.2349,
      "mae_dtheta": 0.0459279902279377,
      "mae_dx": 0.00883674155920744,
      "mae_dy": 0.014230072498321533,
      "pose_mae_dtheta": 0.34689396619796753,
      "pose_mae_dx": 0.14339058101177216,
      "pose_mae_dy": 0.050580862909555435,
      "pose_rmse_dtheta": 0.5884464383125305,
      "pose_rmse_dx": 0.30436551570892334,
      "pose_rmse_dy": 0.12516461312770844,
      "pose_rmse_mean": 0.33932551741600037,
      "rmse_dtheta": 0.07296516001224518,
      "rmse_dx": 0.015793535858392715,
      "rmse_dy": 0.02921014279127121,
      "rmse_mean": 0.03932294622063637,
      "rotation_flip": 0.030534351244568825,
      "sparse_tokens": 1905.0,
      "step": 10217,
      "turn_loss": 0.5366427302360535,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.4747258873815276,
      "grad_norm": 0.7600764632225037,
      "learning_rate": 5.455678097463047e-07,
      "loss": 0.1902,
      "mae_dtheta": 0.03998429700732231,
      "mae_dx": 0.011916992254555225,
      "mae_dy": 0.008789869956672192,
      "pose_mae_dtheta": 0.29805028438568115,
      "pose_mae_dx": 0.06765139102935791,
      "pose_mae_dy": 0.07804612815380096,
      "pose_rmse_dtheta": 0.5139920711517334,
      "pose_rmse_dx": 0.15635643899440765,
      "pose_rmse_dy": 0.18973539769649506,
      "pose_rmse_mean": 0.28669464588165283,
      "rmse_dtheta": 0.060181912034749985,
      "rmse_dx": 0.02330595999956131,
      "rmse_dy": 0.017961466684937477,
      "rmse_mean": 0.033816445618867874,
      "rotation_flip": 0.006666666828095913,
      "sparse_tokens": 5466.0,
      "step": 10218,
      "turn_loss": 0.3334747850894928,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.4747723471473704,
      "grad_norm": 1.0084813833236694,
      "learning_rate": 5.449673790581611e-07,
      "loss": 0.2178,
      "mae_dtheta": 0.03373792767524719,
      "mae_dx": 0.013935636729001999,
      "mae_dy": 0.004757193848490715,
      "pose_mae_dtheta": 0.2556323707103729,
      "pose_mae_dx": 0.11435841768980026,
      "pose_mae_dy": 0.060788240283727646,
      "pose_rmse_dtheta": 0.4732488691806793,
      "pose_rmse_dx": 0.23615886270999908,
      "pose_rmse_dy": 0.12624458968639374,
      "pose_rmse_mean": 0.27855080366134644,
      "rmse_dtheta": 0.05217449367046356,
      "rmse_dx": 0.026729242876172066,
      "rmse_dy": 0.00916728563606739,
      "rmse_mean": 0.029357006773352623,
      "rotation_flip": 0.015625,
      "sparse_tokens": 10637.0,
      "step": 10219,
      "turn_loss": 0.2457951009273529,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.47481880691321315,
      "grad_norm": 0.5796616673469543,
      "learning_rate": 5.443672599128386e-07,
      "loss": 0.112,
      "mae_dtheta": 0.03191393241286278,
      "mae_dx": 0.02249019779264927,
      "mae_dy": 0.007101067341864109,
      "pose_mae_dtheta": 0.2503949999809265,
      "pose_mae_dx": 0.19021104276180267,
      "pose_mae_dy": 0.0889471173286438,
      "pose_rmse_dtheta": 0.3919002413749695,
      "pose_rmse_dx": 0.36903485655784607,
      "pose_rmse_dy": 0.1783832162618637,
      "pose_rmse_mean": 0.31310611963272095,
      "rmse_dtheta": 0.04624755680561066,
      "rmse_dx": 0.03712960705161095,
      "rmse_dy": 0.012717158533632755,
      "rmse_mean": 0.03203144297003746,
      "rotation_flip": 0.019417475908994675,
      "sparse_tokens": 14621.0,
      "step": 10220,
      "turn_loss": 0.3333948254585266,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47486526667905593,
      "grad_norm": 0.5827993154525757,
      "learning_rate": 5.437674523523056e-07,
      "loss": 0.1325,
      "mae_dtheta": 0.007766176015138626,
      "mae_dx": 0.001964929746463895,
      "mae_dy": 0.002125138184055686,
      "pose_mae_dtheta": 0.05351148545742035,
      "pose_mae_dx": 0.020229522138834,
      "pose_mae_dy": 0.018761275336146355,
      "pose_rmse_dtheta": 0.17588719725608826,
      "pose_rmse_dx": 0.06616688519716263,
      "pose_rmse_dy": 0.06395396590232849,
      "pose_rmse_mean": 0.10200268030166626,
      "rmse_dtheta": 0.021285075694322586,
      "rmse_dx": 0.005936435889452696,
      "rmse_dy": 0.00699661998078227,
      "rmse_mean": 0.011406044475734234,
      "rotation_flip": 0.005078485701233149,
      "sparse_tokens": 32121.0,
      "step": 10221,
      "turn_loss": 0.07618661969900131,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32015.0,
      "epoch": 0.4749117264448987,
      "grad_norm": 0.438000351190567,
      "learning_rate": 5.43167956418506e-07,
      "loss": 0.1705,
      "mae_dtheta": 0.04107534512877464,
      "mae_dx": 0.012195698916912079,
      "mae_dy": 0.007236984092742205,
      "pose_mae_dtheta": 0.33695104718208313,
      "pose_mae_dx": 0.09951988607645035,
      "pose_mae_dy": 0.07454116642475128,
      "pose_rmse_dtheta": 0.5676022171974182,
      "pose_rmse_dx": 0.19946664571762085,
      "pose_rmse_dy": 0.15831539034843445,
      "pose_rmse_mean": 0.30846142768859863,
      "rmse_dtheta": 0.05971188843250275,
      "rmse_dx": 0.023754684254527092,
      "rmse_dy": 0.014040673151612282,
      "rmse_mean": 0.032502416521310806,
      "rotation_flip": 0.014160485938191414,
      "sparse_tokens": 24894.0,
      "step": 10222,
      "turn_loss": 0.3188583552837372,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4749581862107415,
      "grad_norm": 0.33554041385650635,
      "learning_rate": 5.425687721533635e-07,
      "loss": 0.0688,
      "mae_dtheta": 0.005314729642122984,
      "mae_dx": 0.0009275045595131814,
      "mae_dy": 0.0006161278579384089,
      "pose_mae_dtheta": 0.03761037811636925,
      "pose_mae_dx": 0.008437427692115307,
      "pose_mae_dy": 0.009115255437791348,
      "pose_rmse_dtheta": 0.16378964483737946,
      "pose_rmse_dx": 0.02219255268573761,
      "pose_rmse_dy": 0.025318920612335205,
      "pose_rmse_mean": 0.07043370604515076,
      "rmse_dtheta": 0.019357165321707726,
      "rmse_dx": 0.0029862807132303715,
      "rmse_dy": 0.0014555513625964522,
      "rmse_mean": 0.007932999171316624,
      "rotation_flip": 0.001742160296998918,
      "sparse_tokens": 32121.0,
      "step": 10223,
      "turn_loss": 0.03488804027438164,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.47500464597658426,
      "grad_norm": 0.5936509370803833,
      "learning_rate": 5.419698995987799e-07,
      "loss": 0.1284,
      "mae_dtheta": 0.01032944954931736,
      "mae_dx": 0.0014937594532966614,
      "mae_dy": 0.0023441454395651817,
      "pose_mae_dtheta": 0.06588777899742126,
      "pose_mae_dx": 0.020372169092297554,
      "pose_mae_dy": 0.028369775041937828,
      "pose_rmse_dtheta": 0.1404549479484558,
      "pose_rmse_dx": 0.05245274677872658,
      "pose_rmse_dy": 0.06363891810178757,
      "pose_rmse_mean": 0.08551554381847382,
      "rmse_dtheta": 0.019332796335220337,
      "rmse_dx": 0.004858430474996567,
      "rmse_dy": 0.004493927117437124,
      "rmse_mean": 0.009561718441545963,
      "rotation_flip": 0.002205882454290986,
      "sparse_tokens": 32073.0,
      "step": 10224,
      "turn_loss": 0.08520887047052383,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.47505110574242704,
      "grad_norm": 0.6654096245765686,
      "learning_rate": 5.413713387966329e-07,
      "loss": 0.1807,
      "mae_dtheta": 0.011767346411943436,
      "mae_dx": 0.0015084741171449423,
      "mae_dy": 0.0025245551951229572,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6654095649719238,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.00672912597656,
      "model/head/act_norm_mean": 101.49854995265152,
      "model/head/act_norm_min": 48.38840866088867,
      "model/head/act_over_embed": 69.75075377185813,
      "model/head/grad_frac": 0.10467398166656494,
      "model/head/grad_norm": 0.06965106725692749,
      "model/head/grad_zero_frac": 0.00017989308980759233,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7131076388888888,
      "model/head/update_ratio": 0.0011857323115691543,
      "model/head/weight_delta": 9.959639549255371,
      "model/head/weight_delta_rel": 0.1747215837240219,
      "model/head/weight_norm": 58.740970611572266,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228515028953552,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227597310662814,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226924479007721,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29052444512770914,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07388560473918915,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04916418716311455,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.517658390410959,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001587490551173687,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1504716873168945,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10293573141098022,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969751358032227,
      "model/modality_embedder/grad_frac": 0.07388560473918915,
      "model/modality_embedder/grad_norm": 0.04916418716311455,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.517658390410959,
      "model/modality_embedder/update_ratio": 0.001587490551173687,
      "model/modality_embedder/weight_delta": 3.1504716873168945,
      "model/modality_embedder/weight_delta_rel": 0.10293573141098022,
      "model/modality_embedder/weight_norm": 30.969751358032227,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.7625503540039,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.769265071348403,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.032866477966309,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.647252126248757,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08605574816465378,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.057262320071458817,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002048154128715396,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7283029556274414,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09942100942134857,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.9580135345459,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.60002136230469,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.691813973063972,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.384049415588379,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.281236368546594,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0770469605922699,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05126778408885002,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017223727190867066,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4595015048980713,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11983983963727951,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.765789031982422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.28412628173828,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.470598845598847,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.15967082977295,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.50363398619891,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07417601346969604,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04935742914676666,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016057941829785705,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7471601963043213,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12582261860370636,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.737083435058594,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.97843933105469,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.22595749158249,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.978767395019531,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.709932881645436,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07368390262126923,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04902997240424156,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0016369959339499474,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2194740772247314,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11002634465694427,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.951187133789062,
      "model/normalizer/grad_frac": 0.27867385745048523,
      "model/normalizer/grad_norm": 0.18543225526809692,
      "model/normalizer/grad_zero_frac": 0.000219803347135894,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0023576191160827875,
      "model/normalizer/weight_delta": 6.773553848266602,
      "model/normalizer/weight_delta_rel": 0.08723945170640945,
      "model/normalizer/weight_norm": 78.65233612060547,
      "pose_mae_dtheta": 0.07690662145614624,
      "pose_mae_dx": 0.023095520213246346,
      "pose_mae_dy": 0.031323544681072235,
      "pose_rmse_dtheta": 0.20745904743671417,
      "pose_rmse_dx": 0.06646907329559326,
      "pose_rmse_dy": 0.06784698367118835,
      "pose_rmse_mean": 0.1139250323176384,
      "rmse_dtheta": 0.025134311988949776,
      "rmse_dx": 0.004909509792923927,
      "rmse_dy": 0.005674436688423157,
      "rmse_mean": 0.011906086467206478,
      "rotation_flip": 0.0027710425201803446,
      "sparse_tokens": 32073.0,
      "step": 10225,
      "turn_loss": 0.08900156617164612,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4750975655082698,
      "grad_norm": 0.4817720353603363,
      "learning_rate": 5.407730897887831e-07,
      "loss": 0.0874,
      "mae_dtheta": 0.010264357551932335,
      "mae_dx": 0.0034495824947953224,
      "mae_dy": 0.004595210775732994,
      "pose_mae_dtheta": 0.0705028772354126,
      "pose_mae_dx": 0.0380994938313961,
      "pose_mae_dy": 0.03314857557415962,
      "pose_rmse_dtheta": 0.17934948205947876,
      "pose_rmse_dx": 0.11906219273805618,
      "pose_rmse_dy": 0.09197980910539627,
      "pose_rmse_mean": 0.13013049960136414,
      "rmse_dtheta": 0.022845648229122162,
      "rmse_dx": 0.010140588507056236,
      "rmse_dy": 0.012211511842906475,
      "rmse_mean": 0.015065917745232582,
      "rotation_flip": 0.0040575433522462845,
      "sparse_tokens": 32105.0,
      "step": 10226,
      "turn_loss": 0.1212182566523552,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.4751440252741126,
      "grad_norm": 0.5408231616020203,
      "learning_rate": 5.401751526170629e-07,
      "loss": 0.0799,
      "mae_dtheta": 0.020014137029647827,
      "mae_dx": 0.011776572093367577,
      "mae_dy": 0.0026419104542583227,
      "pose_mae_dtheta": 0.14979876577854156,
      "pose_mae_dx": 0.09210433810949326,
      "pose_mae_dy": 0.03661729022860527,
      "pose_rmse_dtheta": 0.3003922998905182,
      "pose_rmse_dx": 0.21421808004379272,
      "pose_rmse_dy": 0.10272656381130219,
      "pose_rmse_mean": 0.20577900111675262,
      "rmse_dtheta": 0.034905511885881424,
      "rmse_dx": 0.024178337305784225,
      "rmse_dy": 0.0062555233016610146,
      "rmse_mean": 0.02177979052066803,
      "rotation_flip": 0.005899704992771149,
      "sparse_tokens": 6733.0,
      "step": 10227,
      "turn_loss": 0.1923854500055313,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 24339.0,
      "epoch": 0.4751904850399554,
      "grad_norm": 0.5285994410514832,
      "learning_rate": 5.39577527323289e-07,
      "loss": 0.1156,
      "mae_dtheta": 0.03170180693268776,
      "mae_dx": 0.011523128487169743,
      "mae_dy": 0.003827759763225913,
      "pose_mae_dtheta": 0.2245226800441742,
      "pose_mae_dx": 0.09229013323783875,
      "pose_mae_dy": 0.04872574657201767,
      "pose_rmse_dtheta": 0.428376168012619,
      "pose_rmse_dx": 0.2086995542049408,
      "pose_rmse_dy": 0.11701817810535431,
      "pose_rmse_mean": 0.25136464834213257,
      "rmse_dtheta": 0.051588330417871475,
      "rmse_dx": 0.023920584470033646,
      "rmse_dy": 0.007796536199748516,
      "rmse_mean": 0.027768483385443687,
      "rotation_flip": 0.014604810625314713,
      "sparse_tokens": 18594.0,
      "step": 10228,
      "turn_loss": 0.23244018852710724,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4752369448057982,
      "grad_norm": 0.3691789209842682,
      "learning_rate": 5.389802139492517e-07,
      "loss": 0.058,
      "mae_dtheta": 0.007626883219927549,
      "mae_dx": 0.0012566797668114305,
      "mae_dy": 0.001400568406097591,
      "pose_mae_dtheta": 0.049520332366228104,
      "pose_mae_dx": 0.0171587523072958,
      "pose_mae_dy": 0.019618302583694458,
      "pose_rmse_dtheta": 0.13194890320301056,
      "pose_rmse_dx": 0.045236214995384216,
      "pose_rmse_dy": 0.050096284598112106,
      "pose_rmse_mean": 0.07576046884059906,
      "rmse_dtheta": 0.020059119910001755,
      "rmse_dx": 0.0038489489816129208,
      "rmse_dy": 0.003276892239227891,
      "rmse_mean": 0.009061654098331928,
      "rotation_flip": 0.001985111739486456,
      "sparse_tokens": 32105.0,
      "step": 10229,
      "turn_loss": 0.05983057990670204,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.475283404571641,
      "grad_norm": 0.9105297923088074,
      "learning_rate": 5.383832125367234e-07,
      "loss": 0.1526,
      "mae_dtheta": 0.008067753165960312,
      "mae_dx": 0.0013970168074592948,
      "mae_dy": 0.0021081366576254368,
      "pose_mae_dtheta": 0.0522506944835186,
      "pose_mae_dx": 0.018320025876164436,
      "pose_mae_dy": 0.02036755532026291,
      "pose_rmse_dtheta": 0.13555848598480225,
      "pose_rmse_dx": 0.04554527625441551,
      "pose_rmse_dy": 0.04486372694373131,
      "pose_rmse_mean": 0.07532250136137009,
      "rmse_dtheta": 0.02029670774936676,
      "rmse_dx": 0.0038734448608011007,
      "rmse_dy": 0.005023694597184658,
      "rmse_mean": 0.009731283411383629,
      "rotation_flip": 0.0019455252913758159,
      "sparse_tokens": 32105.0,
      "step": 10230,
      "turn_loss": 0.07318023592233658,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34285.0,
      "epoch": 0.47532986433748375,
      "grad_norm": 0.5419503450393677,
      "learning_rate": 5.377865231274504e-07,
      "loss": 0.1797,
      "mae_dtheta": 0.0307762511074543,
      "mae_dx": 0.011169583536684513,
      "mae_dy": 0.004878557287156582,
      "pose_mae_dtheta": 0.252672016620636,
      "pose_mae_dx": 0.08794014900922775,
      "pose_mae_dy": 0.066237673163414,
      "pose_rmse_dtheta": 0.4348070025444031,
      "pose_rmse_dx": 0.19978436827659607,
      "pose_rmse_dy": 0.13843348622322083,
      "pose_rmse_mean": 0.2576749324798584,
      "rmse_dtheta": 0.046326082199811935,
      "rmse_dx": 0.023034892976284027,
      "rmse_dy": 0.008493488654494286,
      "rmse_mean": 0.025951487943530083,
      "rotation_flip": 0.013819095678627491,
      "sparse_tokens": 26545.0,
      "step": 10231,
      "turn_loss": 0.24189972877502441,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.47537632410332653,
      "grad_norm": 0.46919065713882446,
      "learning_rate": 5.371901457631623e-07,
      "loss": 0.115,
      "mae_dtheta": 0.005296641960740089,
      "mae_dx": 0.0016421544132754207,
      "mae_dy": 0.0012229030253365636,
      "pose_mae_dtheta": 0.034068621695041656,
      "pose_mae_dx": 0.016577282920479774,
      "pose_mae_dy": 0.0140701774507761,
      "pose_rmse_dtheta": 0.08784034103155136,
      "pose_rmse_dx": 0.044371169060468674,
      "pose_rmse_dy": 0.04050901159644127,
      "pose_rmse_mean": 0.057573508471250534,
      "rmse_dtheta": 0.014155027456581593,
      "rmse_dx": 0.004859122913330793,
      "rmse_dy": 0.0028464726638048887,
      "rmse_mean": 0.007286874111741781,
      "rotation_flip": 0.003409644355997443,
      "sparse_tokens": 32153.0,
      "step": 10232,
      "turn_loss": 0.06105295941233635,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4754227838691693,
      "grad_norm": 0.5022559762001038,
      "learning_rate": 5.365940804855624e-07,
      "loss": 0.1057,
      "mae_dtheta": 0.006837811321020126,
      "mae_dx": 0.0017288380768150091,
      "mae_dy": 0.0019089978886768222,
      "pose_mae_dtheta": 0.04700641706585884,
      "pose_mae_dx": 0.015807194635272026,
      "pose_mae_dy": 0.02094675786793232,
      "pose_rmse_dtheta": 0.10473642498254776,
      "pose_rmse_dx": 0.041534315794706345,
      "pose_rmse_dy": 0.04584293067455292,
      "pose_rmse_mean": 0.06403788924217224,
      "rmse_dtheta": 0.01499949861317873,
      "rmse_dx": 0.006035704631358385,
      "rmse_dy": 0.005661345086991787,
      "rmse_mean": 0.008898849599063396,
      "rotation_flip": 0.0038880249485373497,
      "sparse_tokens": 32105.0,
      "step": 10233,
      "turn_loss": 0.06873767822980881,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.4754692436350121,
      "grad_norm": 0.733674943447113,
      "learning_rate": 5.359983273363334e-07,
      "loss": 0.1502,
      "mae_dtheta": 0.03982909023761749,
      "mae_dx": 0.01289646327495575,
      "mae_dy": 0.0034714695066213608,
      "pose_mae_dtheta": 0.34713682532310486,
      "pose_mae_dx": 0.10582327842712402,
      "pose_mae_dy": 0.04865232855081558,
      "pose_rmse_dtheta": 0.6340800523757935,
      "pose_rmse_dx": 0.23597201704978943,
      "pose_rmse_dy": 0.10779539495706558,
      "pose_rmse_mean": 0.32594919204711914,
      "rmse_dtheta": 0.061552442610263824,
      "rmse_dx": 0.025281351059675217,
      "rmse_dy": 0.007467204239219427,
      "rmse_mean": 0.03143366426229477,
      "rotation_flip": 0.012406948022544384,
      "sparse_tokens": 7274.0,
      "step": 10234,
      "turn_loss": 0.2468036264181137,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47551570340085486,
      "grad_norm": 0.4558663070201874,
      "learning_rate": 5.354028863571381e-07,
      "loss": 0.1023,
      "mae_dtheta": 0.0203031487762928,
      "mae_dx": 0.004586874507367611,
      "mae_dy": 0.007342579308897257,
      "pose_mae_dtheta": 0.14914017915725708,
      "pose_mae_dx": 0.05205016955733299,
      "pose_mae_dy": 0.06309627741575241,
      "pose_rmse_dtheta": 0.3066348135471344,
      "pose_rmse_dx": 0.12209610641002655,
      "pose_rmse_dy": 0.16291403770446777,
      "pose_rmse_mean": 0.1972149908542633,
      "rmse_dtheta": 0.03663186356425285,
      "rmse_dx": 0.010653547942638397,
      "rmse_dy": 0.013685270212590694,
      "rmse_mean": 0.020323561504483223,
      "rotation_flip": 0.011111111380159855,
      "sparse_tokens": 32121.0,
      "step": 10235,
      "turn_loss": 0.21071600914001465,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.47556216316669764,
      "grad_norm": 0.5105964541435242,
      "learning_rate": 5.348077575896149e-07,
      "loss": 0.1176,
      "mae_dtheta": 0.03961722552776337,
      "mae_dx": 0.013836445286870003,
      "mae_dy": 0.00473874481394887,
      "pose_mae_dtheta": 0.341936856508255,
      "pose_mae_dx": 0.11129504442214966,
      "pose_mae_dy": 0.07032861560583115,
      "pose_rmse_dtheta": 0.6178654432296753,
      "pose_rmse_dx": 0.2622295320034027,
      "pose_rmse_dy": 0.15420691668987274,
      "pose_rmse_mean": 0.344767302274704,
      "rmse_dtheta": 0.06168147176504135,
      "rmse_dx": 0.028644924983382225,
      "rmse_dy": 0.009265411645174026,
      "rmse_mean": 0.03319726884365082,
      "rotation_flip": 0.01807228848338127,
      "sparse_tokens": 9858.0,
      "step": 10236,
      "turn_loss": 0.27288416028022766,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.4756086229325404,
      "grad_norm": 0.5035507678985596,
      "learning_rate": 5.34212941075381e-07,
      "loss": 0.1499,
      "mae_dtheta": 0.032238397747278214,
      "mae_dx": 0.011056007817387581,
      "mae_dy": 0.007727529387921095,
      "pose_mae_dtheta": 0.23157620429992676,
      "pose_mae_dx": 0.07917015999555588,
      "pose_mae_dy": 0.07714267075061798,
      "pose_rmse_dtheta": 0.4158332943916321,
      "pose_rmse_dx": 0.1923931986093521,
      "pose_rmse_dy": 0.17274849116802216,
      "pose_rmse_mean": 0.26032501459121704,
      "rmse_dtheta": 0.049649059772491455,
      "rmse_dx": 0.023539666086435318,
      "rmse_dy": 0.015456041321158409,
      "rmse_mean": 0.02954825572669506,
      "rotation_flip": 0.010256410576403141,
      "sparse_tokens": 19801.0,
      "step": 10237,
      "turn_loss": 0.26174119114875793,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.4756550826983832,
      "grad_norm": 0.4918588697910309,
      "learning_rate": 5.336184368560343e-07,
      "loss": 0.1447,
      "mae_dtheta": 0.03625953197479248,
      "mae_dx": 0.010766435414552689,
      "mae_dy": 0.008793788030743599,
      "pose_mae_dtheta": 0.2936643958091736,
      "pose_mae_dx": 0.09368347376585007,
      "pose_mae_dy": 0.10011152923107147,
      "pose_rmse_dtheta": 0.450101763010025,
      "pose_rmse_dx": 0.18984630703926086,
      "pose_rmse_dy": 0.21306003630161285,
      "pose_rmse_mean": 0.28433603048324585,
      "rmse_dtheta": 0.05259737744927406,
      "rmse_dx": 0.02219914086163044,
      "rmse_dy": 0.016791269183158875,
      "rmse_mean": 0.030529264360666275,
      "rotation_flip": 0.015068492852151394,
      "sparse_tokens": 10921.0,
      "step": 10238,
      "turn_loss": 0.3380059003829956,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47570154246422597,
      "grad_norm": 0.6931357979774475,
      "learning_rate": 5.330242449731465e-07,
      "loss": 0.1653,
      "mae_dtheta": 0.012590983882546425,
      "mae_dx": 0.0018822140991687775,
      "mae_dy": 0.0033753125462681055,
      "pose_mae_dtheta": 0.07971518486738205,
      "pose_mae_dx": 0.02625182457268238,
      "pose_mae_dy": 0.03774687275290489,
      "pose_rmse_dtheta": 0.18347491323947906,
      "pose_rmse_dx": 0.06906016916036606,
      "pose_rmse_dy": 0.09539211541414261,
      "pose_rmse_mean": 0.11597573012113571,
      "rmse_dtheta": 0.024717792868614197,
      "rmse_dx": 0.0049478430300951,
      "rmse_dy": 0.006626212038099766,
      "rmse_mean": 0.012097283266484737,
      "rotation_flip": 0.0088991429656744,
      "sparse_tokens": 32105.0,
      "step": 10239,
      "turn_loss": 0.10426831245422363,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.47574800223006874,
      "grad_norm": 0.3149830102920532,
      "learning_rate": 5.324303654682722e-07,
      "loss": 0.054,
      "mae_dtheta": 0.005985687021166086,
      "mae_dx": 0.0015704113757237792,
      "mae_dy": 0.00034090090775862336,
      "pose_mae_dtheta": 0.041845474392175674,
      "pose_mae_dx": 0.010819047689437866,
      "pose_mae_dy": 0.00382997072301805,
      "pose_rmse_dtheta": 0.18190619349479675,
      "pose_rmse_dx": 0.040269240736961365,
      "pose_rmse_dy": 0.009788197465240955,
      "pose_rmse_mean": 0.07732121646404266,
      "rmse_dtheta": 0.022541692480444908,
      "rmse_dx": 0.006189393810927868,
      "rmse_dy": 0.001039577997289598,
      "rmse_mean": 0.009923554956912994,
      "rotation_flip": 0.0053557767532765865,
      "sparse_tokens": 32153.0,
      "step": 10240,
      "turn_loss": 0.035831984132528305,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4757944619959115,
      "grad_norm": 0.3272145390510559,
      "learning_rate": 5.318367983829393e-07,
      "loss": 0.0674,
      "mae_dtheta": 0.008858894929289818,
      "mae_dx": 0.0013392599066719413,
      "mae_dy": 0.001776833669282496,
      "pose_mae_dtheta": 0.06358443945646286,
      "pose_mae_dx": 0.017178975045681,
      "pose_mae_dy": 0.021968388929963112,
      "pose_rmse_dtheta": 0.20896559953689575,
      "pose_rmse_dx": 0.052226144820451736,
      "pose_rmse_dy": 0.05302762985229492,
      "pose_rmse_mean": 0.10473980009555817,
      "rmse_dtheta": 0.023734843358397484,
      "rmse_dx": 0.004899040795862675,
      "rmse_dy": 0.004199319984763861,
      "rmse_mean": 0.01094440184533596,
      "rotation_flip": 0.0019811787642538548,
      "sparse_tokens": 32073.0,
      "step": 10241,
      "turn_loss": 0.06030837073922157,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4758409217617543,
      "grad_norm": 0.49437636137008667,
      "learning_rate": 5.312435437586572e-07,
      "loss": 0.086,
      "mae_dtheta": 0.0073562138713896275,
      "mae_dx": 0.0010398452868685126,
      "mae_dy": 0.0012109202798455954,
      "pose_mae_dtheta": 0.05340513214468956,
      "pose_mae_dx": 0.013124056160449982,
      "pose_mae_dy": 0.022399399429559708,
      "pose_rmse_dtheta": 0.1275884211063385,
      "pose_rmse_dx": 0.03211788088083267,
      "pose_rmse_dy": 0.05637381598353386,
      "pose_rmse_mean": 0.07202670723199844,
      "rmse_dtheta": 0.01801249384880066,
      "rmse_dx": 0.0032767592929303646,
      "rmse_dy": 0.0025873922277241945,
      "rmse_mean": 0.007958882488310337,
      "rotation_flip": 0.0030503305606544018,
      "sparse_tokens": 32105.0,
      "step": 10242,
      "turn_loss": 0.05018232390284538,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4758873815275971,
      "grad_norm": 0.4588163495063782,
      "learning_rate": 5.306506016369134e-07,
      "loss": 0.1266,
      "mae_dtheta": 0.00946472305804491,
      "mae_dx": 0.001969084842130542,
      "mae_dy": 0.0031403228640556335,
      "pose_mae_dtheta": 0.06008179858326912,
      "pose_mae_dx": 0.02534790337085724,
      "pose_mae_dy": 0.028535034507513046,
      "pose_rmse_dtheta": 0.12783829867839813,
      "pose_rmse_dx": 0.06723549216985703,
      "pose_rmse_dy": 0.06875886768102646,
      "pose_rmse_mean": 0.08794422447681427,
      "rmse_dtheta": 0.019565658643841743,
      "rmse_dx": 0.005417247768491507,
      "rmse_dy": 0.007666909601539373,
      "rmse_mean": 0.01088327169418335,
      "rotation_flip": 0.010383100248873234,
      "sparse_tokens": 32121.0,
      "step": 10243,
      "turn_loss": 0.09905983507633209,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14253.0,
      "epoch": 0.4759338412934399,
      "grad_norm": 0.8156916499137878,
      "learning_rate": 5.300579720591709e-07,
      "loss": 0.1598,
      "mae_dtheta": 0.03995291516184807,
      "mae_dx": 0.012603238224983215,
      "mae_dy": 0.00566843431442976,
      "pose_mae_dtheta": 0.3383980691432953,
      "pose_mae_dx": 0.08881339430809021,
      "pose_mae_dy": 0.07228074967861176,
      "pose_rmse_dtheta": 0.5546990633010864,
      "pose_rmse_dx": 0.2049901932477951,
      "pose_rmse_dy": 0.16100117564201355,
      "pose_rmse_mean": 0.30689680576324463,
      "rmse_dtheta": 0.05751020461320877,
      "rmse_dx": 0.02559353969991207,
      "rmse_dy": 0.010115258395671844,
      "rmse_mean": 0.03107300214469433,
      "rotation_flip": 0.019021738320589066,
      "sparse_tokens": 11352.0,
      "step": 10244,
      "turn_loss": 0.32533836364746094,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4759803010592827,
      "grad_norm": 0.4883892238140106,
      "learning_rate": 5.294656550668747e-07,
      "loss": 0.135,
      "mae_dtheta": 0.010151898488402367,
      "mae_dx": 0.0014285893412306905,
      "mae_dy": 0.002029322786256671,
      "pose_mae_dtheta": 0.06231235712766647,
      "pose_mae_dx": 0.01872788369655609,
      "pose_mae_dy": 0.027187924832105637,
      "pose_rmse_dtheta": 0.11841841787099838,
      "pose_rmse_dx": 0.04759439453482628,
      "pose_rmse_dy": 0.05590737983584404,
      "pose_rmse_mean": 0.0739734023809433,
      "rmse_dtheta": 0.018872465938329697,
      "rmse_dx": 0.004458216018974781,
      "rmse_dy": 0.003898229915648699,
      "rmse_mean": 0.00907630380243063,
      "rotation_flip": 0.00804681796580553,
      "sparse_tokens": 32105.0,
      "step": 10245,
      "turn_loss": 0.07912158966064453,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47602676082512546,
      "grad_norm": 0.43820664286613464,
      "learning_rate": 5.288736507014436e-07,
      "loss": 0.0919,
      "mae_dtheta": 0.009140277281403542,
      "mae_dx": 0.0012134609278291464,
      "mae_dy": 0.002060471335425973,
      "pose_mae_dtheta": 0.05282136797904968,
      "pose_mae_dx": 0.01893782615661621,
      "pose_mae_dy": 0.020136913284659386,
      "pose_rmse_dtheta": 0.1575668305158615,
      "pose_rmse_dx": 0.04268250986933708,
      "pose_rmse_dy": 0.04245615750551224,
      "pose_rmse_mean": 0.08090183138847351,
      "rmse_dtheta": 0.022860951721668243,
      "rmse_dx": 0.0029656498227268457,
      "rmse_dy": 0.004238984547555447,
      "rmse_mean": 0.010021861642599106,
      "rotation_flip": 0.0059027778916060925,
      "sparse_tokens": 32105.0,
      "step": 10246,
      "turn_loss": 0.07209493219852448,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.47607322059096824,
      "grad_norm": 0.36309316754341125,
      "learning_rate": 5.282819590042793e-07,
      "loss": 0.0852,
      "mae_dtheta": 0.030199041590094566,
      "mae_dx": 0.009279475547373295,
      "mae_dy": 0.0066350409761071205,
      "pose_mae_dtheta": 0.2247089296579361,
      "pose_mae_dx": 0.07827264070510864,
      "pose_mae_dy": 0.0923086479306221,
      "pose_rmse_dtheta": 0.40551602840423584,
      "pose_rmse_dx": 0.15622401237487793,
      "pose_rmse_dy": 0.2295687347650528,
      "pose_rmse_mean": 0.26376959681510925,
      "rmse_dtheta": 0.04688728228211403,
      "rmse_dx": 0.01964324153959751,
      "rmse_dy": 0.013407791964709759,
      "rmse_mean": 0.02664610557258129,
      "rotation_flip": 0.017182130366563797,
      "sparse_tokens": 10614.0,
      "step": 10247,
      "turn_loss": 0.24638380110263824,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.476119680356811,
      "grad_norm": 0.49130886793136597,
      "learning_rate": 5.276905800167564e-07,
      "loss": 0.1565,
      "mae_dtheta": 0.039027828723192215,
      "mae_dx": 0.011109605431556702,
      "mae_dy": 0.007192846853286028,
      "pose_mae_dtheta": 0.2973442077636719,
      "pose_mae_dx": 0.09711980074644089,
      "pose_mae_dy": 0.08300236612558365,
      "pose_rmse_dtheta": 0.5168671607971191,
      "pose_rmse_dx": 0.2177680879831314,
      "pose_rmse_dy": 0.17335565388202667,
      "pose_rmse_mean": 0.3026636242866516,
      "rmse_dtheta": 0.057638514786958694,
      "rmse_dx": 0.022624049335718155,
      "rmse_dy": 0.016305789351463318,
      "rmse_mean": 0.03218945115804672,
      "rotation_flip": 0.01151315774768591,
      "sparse_tokens": 9620.0,
      "step": 10248,
      "turn_loss": 0.3986113369464874,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.4761661401226538,
      "grad_norm": 0.6571751832962036,
      "learning_rate": 5.270995137802315e-07,
      "loss": 0.1738,
      "mae_dtheta": 0.009469723328948021,
      "mae_dx": 0.001239278819411993,
      "mae_dy": 0.00020475468772929162,
      "pose_mae_dtheta": 0.06778785586357117,
      "pose_mae_dx": 0.00895613618195057,
      "pose_mae_dy": 0.002795151202008128,
      "pose_rmse_dtheta": 0.29199716448783875,
      "pose_rmse_dx": 0.021148597821593285,
      "pose_rmse_dy": 0.006098445970565081,
      "pose_rmse_mean": 0.10641473531723022,
      "rmse_dtheta": 0.03375314176082611,
      "rmse_dx": 0.0032927331048995256,
      "rmse_dy": 0.0004564255941659212,
      "rmse_mean": 0.012500766664743423,
      "rotation_flip": 0.0025477707386016846,
      "sparse_tokens": 32217.0,
      "step": 10249,
      "turn_loss": 0.042507972568273544,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47621259988849657,
      "grad_norm": 0.44967716932296753,
      "learning_rate": 5.265087603360398e-07,
      "loss": 0.0992,
      "mae_dtheta": 0.010507957078516483,
      "mae_dx": 0.0025195793714374304,
      "mae_dy": 0.002070407383143902,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44967713952064514,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.63916015625,
      "model/head/act_norm_mean": 104.8981810290404,
      "model/head/act_norm_min": 55.053524017333984,
      "model/head/act_over_embed": 72.08701207540015,
      "model/head/grad_frac": 0.11201976984739304,
      "model/head/grad_norm": 0.05037273094058037,
      "model/head/grad_zero_frac": 0.00018465216271579266,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7037168560606061,
      "model/head/update_ratio": 0.000857537321280688,
      "model/head/weight_delta": 9.960688591003418,
      "model/head/weight_delta_rel": 0.1747399866580963,
      "model/head/weight_norm": 58.741153717041016,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228549897670746,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227727368273543,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42270639538764954,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905333828084803,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09171713143587112,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04124309867620468,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5447029147982063,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013317202683538198,
      "model/modality_embedder.encoders.pose/weight_delta": 3.15024995803833,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10292848199605942,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969791412353516,
      "model/modality_embedder/grad_frac": 0.09171713143587112,
      "model/modality_embedder/grad_norm": 0.04124309867620468,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5447029147982063,
      "model/modality_embedder/update_ratio": 0.0013317202683538198,
      "model/modality_embedder/weight_delta": 3.15024995803833,
      "model/modality_embedder/weight_delta_rel": 0.10292848199605942,
      "model/modality_embedder/weight_norm": 30.969791412353516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.68019104003906,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.10159381513548,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.003339767456055,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.875631550289954,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09025599807500839,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04058605805039406,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014516731025651097,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.728881359100342,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09944208711385727,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.958126068115234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.40946197509766,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.04991632595799,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.305801391601562,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.52732765806241,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0830247774720192,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.037334345281124115,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012542603071779013,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4602651596069336,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11986628919839859,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76602554321289,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.49800872802734,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.851626382876383,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.436234474182129,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.76547967705204,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08307269960641861,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03735589236021042,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012153256684541702,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7480006217956543,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1258508414030075,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.737350463867188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.27584838867188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.591500320666988,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.515630722045898,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.961137336058187,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0853785052895546,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03839276358485222,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012818376999348402,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.220329999923706,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1100555956363678,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.951345443725586,
      "model/normalizer/grad_frac": 0.32605212926864624,
      "model/normalizer/grad_norm": 0.14661818742752075,
      "model/normalizer/grad_zero_frac": 0.00016662511916365474,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018641249043866992,
      "model/normalizer/weight_delta": 6.775110244750977,
      "model/normalizer/weight_delta_rel": 0.08725949376821518,
      "model/normalizer/weight_norm": 78.65255737304688,
      "pose_mae_dtheta": 0.0667426660656929,
      "pose_mae_dx": 0.028422269970178604,
      "pose_mae_dy": 0.025620419532060623,
      "pose_rmse_dtheta": 0.1627381145954132,
      "pose_rmse_dx": 0.10155565291643143,
      "pose_rmse_dy": 0.05979439243674278,
      "pose_rmse_mean": 0.10802938789129257,
      "rmse_dtheta": 0.02221205085515976,
      "rmse_dx": 0.009526058100163937,
      "rmse_dy": 0.004983106162399054,
      "rmse_mean": 0.012240405194461346,
      "rotation_flip": 0.005855290684849024,
      "sparse_tokens": 32105.0,
      "step": 10250,
      "turn_loss": 0.09920596331357956,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47625905965433935,
      "grad_norm": 0.5799586772918701,
      "learning_rate": 5.259183197254903e-07,
      "loss": 0.1333,
      "mae_dtheta": 0.009056659415364265,
      "mae_dx": 0.0017473549814894795,
      "mae_dy": 0.0023341579362750053,
      "pose_mae_dtheta": 0.05940461903810501,
      "pose_mae_dx": 0.02137557975947857,
      "pose_mae_dy": 0.023701902478933334,
      "pose_rmse_dtheta": 0.16037768125534058,
      "pose_rmse_dx": 0.058799486607313156,
      "pose_rmse_dy": 0.05698345601558685,
      "pose_rmse_mean": 0.09205354750156403,
      "rmse_dtheta": 0.021264009177684784,
      "rmse_dx": 0.005099779926240444,
      "rmse_dy": 0.006086956709623337,
      "rmse_mean": 0.010816915892064571,
      "rotation_flip": 0.0019470405532047153,
      "sparse_tokens": 32121.0,
      "step": 10251,
      "turn_loss": 0.08512173593044281,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4763055194201821,
      "grad_norm": 0.35512545704841614,
      "learning_rate": 5.253281919898751e-07,
      "loss": 0.0813,
      "mae_dtheta": 0.007757213432341814,
      "mae_dx": 0.0011110811028629541,
      "mae_dy": 0.001076470478437841,
      "pose_mae_dtheta": 0.04603283852338791,
      "pose_mae_dx": 0.011650958098471165,
      "pose_mae_dy": 0.01326848566532135,
      "pose_rmse_dtheta": 0.12049061059951782,
      "pose_rmse_dx": 0.03271251916885376,
      "pose_rmse_dy": 0.03080238215625286,
      "pose_rmse_mean": 0.06133517250418663,
      "rmse_dtheta": 0.01751616597175598,
      "rmse_dx": 0.004284396301954985,
      "rmse_dy": 0.0024510330986231565,
      "rmse_mean": 0.00808386504650116,
      "rotation_flip": 0.00273348530754447,
      "sparse_tokens": 32073.0,
      "step": 10252,
      "turn_loss": 0.0629710927605629,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.4763519791860249,
      "grad_norm": 0.9247738122940063,
      "learning_rate": 5.247383771704601e-07,
      "loss": 0.2191,
      "mae_dtheta": 0.024609889835119247,
      "mae_dx": 0.011039871722459793,
      "mae_dy": 0.003881689626723528,
      "pose_mae_dtheta": 0.16199764609336853,
      "pose_mae_dx": 0.09371203184127808,
      "pose_mae_dy": 0.047790512442588806,
      "pose_rmse_dtheta": 0.28509005904197693,
      "pose_rmse_dx": 0.2587578296661377,
      "pose_rmse_dy": 0.11010158061981201,
      "pose_rmse_mean": 0.2179831713438034,
      "rmse_dtheta": 0.03884764388203621,
      "rmse_dx": 0.0252236220985651,
      "rmse_dy": 0.008484818041324615,
      "rmse_mean": 0.024185363203287125,
      "rotation_flip": 0.0199115052819252,
      "sparse_tokens": 9791.0,
      "step": 10253,
      "turn_loss": 0.1742996722459793,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4763984389518677,
      "grad_norm": 0.5365786552429199,
      "learning_rate": 5.241488753084939e-07,
      "loss": 0.1273,
      "mae_dtheta": 0.011554121971130371,
      "mae_dx": 0.0029023655224591494,
      "mae_dy": 0.0025969636626541615,
      "pose_mae_dtheta": 0.07442005723714828,
      "pose_mae_dx": 0.031339533627033234,
      "pose_mae_dy": 0.03283929079771042,
      "pose_rmse_dtheta": 0.1861112117767334,
      "pose_rmse_dx": 0.08258821815252304,
      "pose_rmse_dy": 0.08204486221075058,
      "pose_rmse_mean": 0.1169147714972496,
      "rmse_dtheta": 0.02489732950925827,
      "rmse_dx": 0.00919194146990776,
      "rmse_dy": 0.0056629120372235775,
      "rmse_mean": 0.013250727206468582,
      "rotation_flip": 0.006515906658023596,
      "sparse_tokens": 32089.0,
      "step": 10254,
      "turn_loss": 0.13088665902614594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.47644489871771045,
      "grad_norm": 0.7040613889694214,
      "learning_rate": 5.235596864451975e-07,
      "loss": 0.1862,
      "mae_dtheta": 0.01521276030689478,
      "mae_dx": 0.0021287216804921627,
      "mae_dy": 0.004313217010349035,
      "pose_mae_dtheta": 0.10073764622211456,
      "pose_mae_dx": 0.030475225299596786,
      "pose_mae_dy": 0.0455656535923481,
      "pose_rmse_dtheta": 0.23170088231563568,
      "pose_rmse_dx": 0.07114926725625992,
      "pose_rmse_dy": 0.1003868356347084,
      "pose_rmse_mean": 0.13441233336925507,
      "rmse_dtheta": 0.02758944220840931,
      "rmse_dx": 0.00499690230935812,
      "rmse_dy": 0.007821880280971527,
      "rmse_mean": 0.013469408266246319,
      "rotation_flip": 0.010830325074493885,
      "sparse_tokens": 32137.0,
      "step": 10255,
      "turn_loss": 0.13610702753067017,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47649135848355323,
      "grad_norm": 0.7123478651046753,
      "learning_rate": 5.229708106217751e-07,
      "loss": 0.128,
      "mae_dtheta": 0.012319200672209263,
      "mae_dx": 0.002665897598490119,
      "mae_dy": 0.0038285949267446995,
      "pose_mae_dtheta": 0.08774171769618988,
      "pose_mae_dx": 0.02857138216495514,
      "pose_mae_dy": 0.030685340985655785,
      "pose_rmse_dtheta": 0.2207297384738922,
      "pose_rmse_dx": 0.09017292410135269,
      "pose_rmse_dy": 0.0846346989274025,
      "pose_rmse_mean": 0.13184578716754913,
      "rmse_dtheta": 0.027803055942058563,
      "rmse_dx": 0.007299682591110468,
      "rmse_dy": 0.010117126628756523,
      "rmse_mean": 0.015073290094733238,
      "rotation_flip": 0.009140008129179478,
      "sparse_tokens": 32105.0,
      "step": 10256,
      "turn_loss": 0.10401244461536407,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.476537818249396,
      "grad_norm": 0.7426854968070984,
      "learning_rate": 5.223822478794083e-07,
      "loss": 0.1268,
      "mae_dtheta": 0.00896134227514267,
      "mae_dx": 0.0013516816543415189,
      "mae_dy": 0.001891454798169434,
      "pose_mae_dtheta": 0.060439009219408035,
      "pose_mae_dx": 0.017161080613732338,
      "pose_mae_dy": 0.021418670192360878,
      "pose_rmse_dtheta": 0.17680275440216064,
      "pose_rmse_dx": 0.04642393812537193,
      "pose_rmse_dy": 0.052710916846990585,
      "pose_rmse_mean": 0.09197920560836792,
      "rmse_dtheta": 0.023319760337471962,
      "rmse_dx": 0.004459851421415806,
      "rmse_dy": 0.005175515543669462,
      "rmse_mean": 0.01098504289984703,
      "rotation_flip": 0.002686968306079507,
      "sparse_tokens": 32089.0,
      "step": 10257,
      "turn_loss": 0.07043334096670151,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4765842780152388,
      "grad_norm": 0.5055510401725769,
      "learning_rate": 5.217939982592529e-07,
      "loss": 0.1239,
      "mae_dtheta": 0.006792728789150715,
      "mae_dx": 0.0014420610386878252,
      "mae_dy": 0.0016813335241749883,
      "pose_mae_dtheta": 0.04920096695423126,
      "pose_mae_dx": 0.0121877146884799,
      "pose_mae_dy": 0.017464889213442802,
      "pose_rmse_dtheta": 0.14121198654174805,
      "pose_rmse_dx": 0.04401717707514763,
      "pose_rmse_dy": 0.04579247906804085,
      "pose_rmse_mean": 0.0770072191953659,
      "rmse_dtheta": 0.0187224168330431,
      "rmse_dx": 0.005001341924071312,
      "rmse_dy": 0.006038108840584755,
      "rmse_mean": 0.009920623153448105,
      "rotation_flip": 0.004014273174107075,
      "sparse_tokens": 32153.0,
      "step": 10258,
      "turn_loss": 0.05467679351568222,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.47663073778108156,
      "grad_norm": 0.7240696549415588,
      "learning_rate": 5.212060618024473e-07,
      "loss": 0.1518,
      "mae_dtheta": 0.03809892758727074,
      "mae_dx": 0.013833503238856792,
      "mae_dy": 0.011110630817711353,
      "pose_mae_dtheta": 0.3355741798877716,
      "pose_mae_dx": 0.1469941884279251,
      "pose_mae_dy": 0.14172996580600739,
      "pose_rmse_dtheta": 0.4771396517753601,
      "pose_rmse_dx": 0.3179871141910553,
      "pose_rmse_dy": 0.2941221594810486,
      "pose_rmse_mean": 0.36308297514915466,
      "rmse_dtheta": 0.05414852872490883,
      "rmse_dx": 0.02696658857166767,
      "rmse_dy": 0.021541878581047058,
      "rmse_mean": 0.03421900048851967,
      "rotation_flip": 0.019512195140123367,
      "sparse_tokens": 3459.0,
      "step": 10259,
      "turn_loss": 0.43237945437431335,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.47667719754692434,
      "grad_norm": 0.628026008605957,
      "learning_rate": 5.206184385501057e-07,
      "loss": 0.1679,
      "mae_dtheta": 0.0376061275601387,
      "mae_dx": 0.008536620996892452,
      "mae_dy": 0.0053751165978610516,
      "pose_mae_dtheta": 0.31562650203704834,
      "pose_mae_dx": 0.05540095642209053,
      "pose_mae_dy": 0.07016190886497498,
      "pose_rmse_dtheta": 0.5996163487434387,
      "pose_rmse_dx": 0.11664188653230667,
      "pose_rmse_dy": 0.17899936437606812,
      "pose_rmse_mean": 0.29841920733451843,
      "rmse_dtheta": 0.06066504865884781,
      "rmse_dx": 0.01894482597708702,
      "rmse_dy": 0.011045983992516994,
      "rmse_mean": 0.030218619853258133,
      "rotation_flip": 0.009776536375284195,
      "sparse_tokens": 11951.0,
      "step": 10260,
      "turn_loss": 0.24960067868232727,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47672365731276717,
      "grad_norm": 0.5345251560211182,
      "learning_rate": 5.200311285433213e-07,
      "loss": 0.1003,
      "mae_dtheta": 0.008652303367853165,
      "mae_dx": 0.0014665520284324884,
      "mae_dy": 0.0021335866767913103,
      "pose_mae_dtheta": 0.05041186884045601,
      "pose_mae_dx": 0.01782732829451561,
      "pose_mae_dy": 0.02352127991616726,
      "pose_rmse_dtheta": 0.12613239884376526,
      "pose_rmse_dx": 0.05547264590859413,
      "pose_rmse_dy": 0.0662686675786972,
      "pose_rmse_mean": 0.08262456953525543,
      "rmse_dtheta": 0.020101001486182213,
      "rmse_dx": 0.004742960445582867,
      "rmse_dy": 0.00531792314723134,
      "rmse_mean": 0.010053961537778378,
      "rotation_flip": 0.004271678626537323,
      "sparse_tokens": 32105.0,
      "step": 10261,
      "turn_loss": 0.0752900093793869,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33634.0,
      "epoch": 0.47677011707860995,
      "grad_norm": 0.41721558570861816,
      "learning_rate": 5.194441318231635e-07,
      "loss": 0.111,
      "mae_dtheta": 0.035927191376686096,
      "mae_dx": 0.010395335033535957,
      "mae_dy": 0.0059975250624120235,
      "pose_mae_dtheta": 0.27540677785873413,
      "pose_mae_dx": 0.08844839036464691,
      "pose_mae_dy": 0.07519709318876266,
      "pose_rmse_dtheta": 0.49382418394088745,
      "pose_rmse_dx": 0.20201103389263153,
      "pose_rmse_dy": 0.17722268402576447,
      "pose_rmse_mean": 0.2910193204879761,
      "rmse_dtheta": 0.05486023798584938,
      "rmse_dx": 0.021814649924635887,
      "rmse_dy": 0.012415075674653053,
      "rmse_mean": 0.02969665452837944,
      "rotation_flip": 0.018046049401164055,
      "sparse_tokens": 26734.0,
      "step": 10262,
      "turn_loss": 0.31702524423599243,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.4768165768444527,
      "grad_norm": 0.6414753794670105,
      "learning_rate": 5.188574484306829e-07,
      "loss": 0.0836,
      "mae_dtheta": 0.024847790598869324,
      "mae_dx": 0.006310709286481142,
      "mae_dy": 0.0026974272914230824,
      "pose_mae_dtheta": 0.195414736866951,
      "pose_mae_dx": 0.05218254402279854,
      "pose_mae_dy": 0.03194542974233627,
      "pose_rmse_dtheta": 0.36322498321533203,
      "pose_rmse_dx": 0.10718514770269394,
      "pose_rmse_dy": 0.08452285081148148,
      "pose_rmse_mean": 0.1849776804447174,
      "rmse_dtheta": 0.042895831167697906,
      "rmse_dx": 0.015035286545753479,
      "rmse_dy": 0.005667056888341904,
      "rmse_mean": 0.021199390292167664,
      "rotation_flip": 0.0,
      "sparse_tokens": 5502.0,
      "step": 10263,
      "turn_loss": 0.15022540092468262,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4768630366102955,
      "grad_norm": 0.48926210403442383,
      "learning_rate": 5.182710784069067e-07,
      "loss": 0.1462,
      "mae_dtheta": 0.01057516224682331,
      "mae_dx": 0.0016421301988884807,
      "mae_dy": 0.002267287578433752,
      "pose_mae_dtheta": 0.07511282712221146,
      "pose_mae_dx": 0.02239876426756382,
      "pose_mae_dy": 0.02886204794049263,
      "pose_rmse_dtheta": 0.20264868438243866,
      "pose_rmse_dx": 0.05897786095738411,
      "pose_rmse_dy": 0.0670875832438469,
      "pose_rmse_mean": 0.10957138240337372,
      "rmse_dtheta": 0.023085372522473335,
      "rmse_dx": 0.005588999949395657,
      "rmse_dy": 0.00529093760997057,
      "rmse_mean": 0.011321770027279854,
      "rotation_flip": 0.0029695620760321617,
      "sparse_tokens": 32105.0,
      "step": 10264,
      "turn_loss": 0.0844091922044754,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.4769094963761383,
      "grad_norm": 0.4541315734386444,
      "learning_rate": 5.176850217928386e-07,
      "loss": 0.1326,
      "mae_dtheta": 0.041591543704271317,
      "mae_dx": 0.013320540077984333,
      "mae_dy": 0.008999628946185112,
      "pose_mae_dtheta": 0.3313101530075073,
      "pose_mae_dx": 0.11419229954481125,
      "pose_mae_dy": 0.08352139592170715,
      "pose_rmse_dtheta": 0.5404828190803528,
      "pose_rmse_dx": 0.24017921090126038,
      "pose_rmse_dy": 0.20600774884223938,
      "pose_rmse_mean": 0.328889936208725,
      "rmse_dtheta": 0.06032167002558708,
      "rmse_dx": 0.02547135204076767,
      "rmse_dy": 0.01933850534260273,
      "rmse_mean": 0.03504384309053421,
      "rotation_flip": 0.019701087847352028,
      "sparse_tokens": 21780.0,
      "step": 10265,
      "turn_loss": 0.4482247829437256,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.47695595614198105,
      "grad_norm": 0.8377615809440613,
      "learning_rate": 5.170992786294638e-07,
      "loss": 0.2613,
      "mae_dtheta": 0.020956669002771378,
      "mae_dx": 0.007482354063540697,
      "mae_dy": 0.0035377892199903727,
      "pose_mae_dtheta": 0.1483066827058792,
      "pose_mae_dx": 0.06137673556804657,
      "pose_mae_dy": 0.03822099417448044,
      "pose_rmse_dtheta": 0.2838478684425354,
      "pose_rmse_dx": 0.14984415471553802,
      "pose_rmse_dy": 0.08023837953805923,
      "pose_rmse_mean": 0.171310156583786,
      "rmse_dtheta": 0.03703166916966438,
      "rmse_dx": 0.018197141587734222,
      "rmse_dy": 0.006659854203462601,
      "rmse_mean": 0.020629554986953735,
      "rotation_flip": 0.007496251724660397,
      "sparse_tokens": 13301.0,
      "step": 10266,
      "turn_loss": 0.18147163093090057,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47700241590782383,
      "grad_norm": 0.3726936876773834,
      "learning_rate": 5.165138489577415e-07,
      "loss": 0.0628,
      "mae_dtheta": 0.006096518132835627,
      "mae_dx": 0.001120264525525272,
      "mae_dy": 0.0006318215746432543,
      "pose_mae_dtheta": 0.043178677558898926,
      "pose_mae_dx": 0.010351828299462795,
      "pose_mae_dy": 0.009151529520750046,
      "pose_rmse_dtheta": 0.19194166362285614,
      "pose_rmse_dx": 0.03672231361269951,
      "pose_rmse_dy": 0.03008325584232807,
      "pose_rmse_mean": 0.08624908328056335,
      "rmse_dtheta": 0.022186871618032455,
      "rmse_dx": 0.004403840750455856,
      "rmse_dy": 0.0021348162554204464,
      "rmse_mean": 0.009575176984071732,
      "rotation_flip": 0.000684462720528245,
      "sparse_tokens": 32121.0,
      "step": 10267,
      "turn_loss": 0.03272842988371849,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29754.0,
      "epoch": 0.4770488756736666,
      "grad_norm": 0.6840161085128784,
      "learning_rate": 5.159287328186136e-07,
      "loss": 0.1456,
      "mae_dtheta": 0.02744789607822895,
      "mae_dx": 0.01283129584044218,
      "mae_dy": 0.004820568952709436,
      "pose_mae_dtheta": 0.2148430496454239,
      "pose_mae_dx": 0.1037607491016388,
      "pose_mae_dy": 0.054500505328178406,
      "pose_rmse_dtheta": 0.43535229563713074,
      "pose_rmse_dx": 0.23908722400665283,
      "pose_rmse_dy": 0.15228500962257385,
      "pose_rmse_mean": 0.27557486295700073,
      "rmse_dtheta": 0.04679310321807861,
      "rmse_dx": 0.02594946324825287,
      "rmse_dy": 0.011659286916255951,
      "rmse_mean": 0.028133951127529144,
      "rotation_flip": 0.008583690971136093,
      "sparse_tokens": 24701.0,
      "step": 10268,
      "turn_loss": 0.20904260873794556,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4770953354395094,
      "grad_norm": 0.4018980860710144,
      "learning_rate": 5.153439302529944e-07,
      "loss": 0.114,
      "mae_dtheta": 0.0076941451989114285,
      "mae_dx": 0.001699740649200976,
      "mae_dy": 0.001806521089747548,
      "pose_mae_dtheta": 0.0473807267844677,
      "pose_mae_dx": 0.021741487085819244,
      "pose_mae_dy": 0.02169927954673767,
      "pose_rmse_dtheta": 0.10478037595748901,
      "pose_rmse_dx": 0.05290684849023819,
      "pose_rmse_dy": 0.05028485134243965,
      "pose_rmse_mean": 0.06932402402162552,
      "rmse_dtheta": 0.017346639186143875,
      "rmse_dx": 0.004965262953191996,
      "rmse_dy": 0.0040281713008880615,
      "rmse_mean": 0.008780024945735931,
      "rotation_flip": 0.003382663941010833,
      "sparse_tokens": 32089.0,
      "step": 10269,
      "turn_loss": 0.06849062442779541,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.47714179520535216,
      "grad_norm": 0.37029340863227844,
      "learning_rate": 5.147594413017826e-07,
      "loss": 0.0743,
      "mae_dtheta": 0.006733893882483244,
      "mae_dx": 0.0009769502794370055,
      "mae_dy": 0.0005012026522308588,
      "pose_mae_dtheta": 0.045045237988233566,
      "pose_mae_dx": 0.008274894207715988,
      "pose_mae_dy": 0.008868066594004631,
      "pose_rmse_dtheta": 0.18384110927581787,
      "pose_rmse_dx": 0.02721463330090046,
      "pose_rmse_dy": 0.0323137529194355,
      "pose_rmse_mean": 0.08112316578626633,
      "rmse_dtheta": 0.023956308141350746,
      "rmse_dx": 0.0038718366995453835,
      "rmse_dy": 0.0013539523351937532,
      "rmse_mean": 0.009727366268634796,
      "rotation_flip": 0.0022148394491523504,
      "sparse_tokens": 32137.0,
      "step": 10270,
      "turn_loss": 0.03964901342988014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.47718825497119494,
      "grad_norm": 0.6259354948997498,
      "learning_rate": 5.141752660058508e-07,
      "loss": 0.127,
      "mae_dtheta": 0.03556282818317413,
      "mae_dx": 0.011757154017686844,
      "mae_dy": 0.0038482004310935736,
      "pose_mae_dtheta": 0.26216986775398254,
      "pose_mae_dx": 0.0885462686419487,
      "pose_mae_dy": 0.03924097865819931,
      "pose_rmse_dtheta": 0.43009597063064575,
      "pose_rmse_dx": 0.20536769926548004,
      "pose_rmse_dy": 0.08501841872930527,
      "pose_rmse_mean": 0.24016068875789642,
      "rmse_dtheta": 0.05252661928534508,
      "rmse_dx": 0.023984385654330254,
      "rmse_dy": 0.007389307953417301,
      "rmse_mean": 0.02796677127480507,
      "rotation_flip": 0.020356234163045883,
      "sparse_tokens": 11480.0,
      "step": 10271,
      "turn_loss": 0.2873117923736572,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.4772347147370377,
      "grad_norm": 0.7247459292411804,
      "learning_rate": 5.135914044060486e-07,
      "loss": 0.1711,
      "mae_dtheta": 0.04021783918142319,
      "mae_dx": 0.011221418157219887,
      "mae_dy": 0.0035825748927891254,
      "pose_mae_dtheta": 0.33405110239982605,
      "pose_mae_dx": 0.07840976119041443,
      "pose_mae_dy": 0.03858863189816475,
      "pose_rmse_dtheta": 0.5343547463417053,
      "pose_rmse_dx": 0.1817106157541275,
      "pose_rmse_dy": 0.1079145297408104,
      "pose_rmse_mean": 0.2746599614620209,
      "rmse_dtheta": 0.05778319388628006,
      "rmse_dx": 0.023390810936689377,
      "rmse_dy": 0.008088666014373302,
      "rmse_mean": 0.029754221439361572,
      "rotation_flip": 0.019940178841352463,
      "sparse_tokens": 13735.0,
      "step": 10272,
      "turn_loss": 0.25773805379867554,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4772811745028805,
      "grad_norm": 0.3082694411277771,
      "learning_rate": 5.130078565432089e-07,
      "loss": 0.0716,
      "mae_dtheta": 0.008650324307382107,
      "mae_dx": 0.0010389205999672413,
      "mae_dy": 0.0011354482267051935,
      "pose_mae_dtheta": 0.056255459785461426,
      "pose_mae_dx": 0.012003740295767784,
      "pose_mae_dy": 0.015451991930603981,
      "pose_rmse_dtheta": 0.19984948635101318,
      "pose_rmse_dx": 0.03092074766755104,
      "pose_rmse_dy": 0.03733758255839348,
      "pose_rmse_mean": 0.0893692672252655,
      "rmse_dtheta": 0.023103240877389908,
      "rmse_dx": 0.003387520555406809,
      "rmse_dy": 0.0024351440370082855,
      "rmse_mean": 0.00964196864515543,
      "rotation_flip": 0.0049019609577953815,
      "sparse_tokens": 32137.0,
      "step": 10273,
      "turn_loss": 0.054179027676582336,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47732763426872327,
      "grad_norm": 0.5632989406585693,
      "learning_rate": 5.124246224581375e-07,
      "loss": 0.1058,
      "mae_dtheta": 0.007825531996786594,
      "mae_dx": 0.0012974092969670892,
      "mae_dy": 0.001931175822392106,
      "pose_mae_dtheta": 0.050239939242601395,
      "pose_mae_dx": 0.015593593008816242,
      "pose_mae_dy": 0.02136141061782837,
      "pose_rmse_dtheta": 0.1006622314453125,
      "pose_rmse_dx": 0.038229573518037796,
      "pose_rmse_dy": 0.05050383508205414,
      "pose_rmse_mean": 0.06313188374042511,
      "rmse_dtheta": 0.017442718148231506,
      "rmse_dx": 0.003765028901398182,
      "rmse_dy": 0.004321920219808817,
      "rmse_mean": 0.008509889245033264,
      "rotation_flip": 0.003116478445008397,
      "sparse_tokens": 32105.0,
      "step": 10274,
      "turn_loss": 0.06814554333686829,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.47737409403456604,
      "grad_norm": 0.48247891664505005,
      "learning_rate": 5.118417021916205e-07,
      "loss": 0.1152,
      "mae_dtheta": 0.03834585100412369,
      "mae_dx": 0.007736735977232456,
      "mae_dy": 0.003179492661729455,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.48247888684272766,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 137.36041259765625,
      "model/head/act_norm_mean": 98.06197102864583,
      "model/head/act_norm_min": 59.771968841552734,
      "model/head/act_over_embed": 67.38910456152263,
      "model/head/grad_frac": 0.11859380453824997,
      "model/head/grad_norm": 0.0572190061211586,
      "model/head/grad_zero_frac": 0.00020178484555799514,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6838107638888888,
      "model/head/update_ratio": 0.0009740859386511147,
      "model/head/weight_delta": 9.961819648742676,
      "model/head/weight_delta_rel": 0.17475982010364532,
      "model/head/weight_norm": 58.74123001098633,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42286914587020874,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42279271821717956,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227142632007599,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.290547114206637,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11082702875137329,
      "model/modality_embedder.encoders.pose/grad_norm": 0.053471703082323074,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.547191722972973,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017265776405110955,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1504592895507812,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1029353216290474,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969764709472656,
      "model/modality_embedder/grad_frac": 0.11082702875137329,
      "model/modality_embedder/grad_norm": 0.053471703082323074,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.547191722972973,
      "model/modality_embedder/update_ratio": 0.0017265776405110955,
      "model/modality_embedder/weight_delta": 3.1504592895507812,
      "model/modality_embedder/weight_delta_rel": 0.1029353216290474,
      "model/modality_embedder/weight_norm": 30.969764709472656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.8440933227539,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.51438147597002,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.242592811584473,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.472093733246915,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07020825892686844,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03387400135397911,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012115917634218931,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7295124530792236,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09946507960557938,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.958263397216797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 75.51754760742188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.35227210097002,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.99489974975586,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.047900015202536,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07758308947086334,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03743220120668411,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012575413566082716,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4609665870666504,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11989058554172516,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.766178131103516,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 77.40705108642578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.987141065917108,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.384627342224121,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.171397273798576,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0915040373802185,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0441487655043602,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014363161753863096,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7488036155700684,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12587781250476837,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.737497329711914,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 78.15998840332031,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.808185557208994,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.90710163116455,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.422836097101495,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09380662441253662,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.045259714126586914,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015111002139747143,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.221019983291626,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11007917672395706,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95149803161621,
      "model/normalizer/grad_frac": 0.35645195841789246,
      "model/normalizer/grad_norm": 0.17198054492473602,
      "model/normalizer/grad_zero_frac": 0.00022334855748340487,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002186579629778862,
      "model/normalizer/weight_delta": 6.776552677154541,
      "model/normalizer/weight_delta_rel": 0.08727807551622391,
      "model/normalizer/weight_norm": 78.65277099609375,
      "pose_mae_dtheta": 0.30461904406547546,
      "pose_mae_dx": 0.06639212369918823,
      "pose_mae_dy": 0.03822551295161247,
      "pose_rmse_dtheta": 0.5285288691520691,
      "pose_rmse_dx": 0.17862577736377716,
      "pose_rmse_dy": 0.10152450203895569,
      "pose_rmse_mean": 0.26955971121788025,
      "rmse_dtheta": 0.05924750864505768,
      "rmse_dx": 0.01876470074057579,
      "rmse_dy": 0.007441813126206398,
      "rmse_mean": 0.028484676033258438,
      "rotation_flip": 0.016447369009256363,
      "sparse_tokens": 9679.0,
      "step": 10275,
      "turn_loss": 0.24146154522895813,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4774205538004088,
      "grad_norm": 0.4166702926158905,
      "learning_rate": 5.112590957844233e-07,
      "loss": 0.1161,
      "mae_dtheta": 0.007776760961860418,
      "mae_dx": 0.0016709467163309455,
      "mae_dy": 0.0018135170685127378,
      "pose_mae_dtheta": 0.05215530842542648,
      "pose_mae_dx": 0.019923696294426918,
      "pose_mae_dy": 0.021030345931649208,
      "pose_rmse_dtheta": 0.12872907519340515,
      "pose_rmse_dx": 0.05072306841611862,
      "pose_rmse_dy": 0.052062977105379105,
      "pose_rmse_mean": 0.07717171311378479,
      "rmse_dtheta": 0.018300117924809456,
      "rmse_dx": 0.00542982155457139,
      "rmse_dy": 0.0037578949704766273,
      "rmse_mean": 0.009162611328065395,
      "rotation_flip": 0.0008833922329358757,
      "sparse_tokens": 32073.0,
      "step": 10276,
      "turn_loss": 0.0706028863787651,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.47746701356625165,
      "grad_norm": 0.5148413181304932,
      "learning_rate": 5.106768032772852e-07,
      "loss": 0.1109,
      "mae_dtheta": 0.009984757751226425,
      "mae_dx": 0.002226652577519417,
      "mae_dy": 0.002142716199159622,
      "pose_mae_dtheta": 0.06690648943185806,
      "pose_mae_dx": 0.02259148098528385,
      "pose_mae_dy": 0.02431320585310459,
      "pose_rmse_dtheta": 0.1690417379140854,
      "pose_rmse_dx": 0.059809934347867966,
      "pose_rmse_dy": 0.0621502660214901,
      "pose_rmse_mean": 0.09700065106153488,
      "rmse_dtheta": 0.02244601771235466,
      "rmse_dx": 0.0066147660836577415,
      "rmse_dy": 0.0048415325582027435,
      "rmse_mean": 0.011300772428512573,
      "rotation_flip": 0.0037579857744276524,
      "sparse_tokens": 32185.0,
      "step": 10277,
      "turn_loss": 0.08566340804100037,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.47751347333209443,
      "grad_norm": 0.2943497896194458,
      "learning_rate": 5.100948247109294e-07,
      "loss": 0.0677,
      "mae_dtheta": 0.008705596439540386,
      "mae_dx": 0.0014762005303055048,
      "mae_dy": 0.0019636426586657763,
      "pose_mae_dtheta": 0.05974287539720535,
      "pose_mae_dx": 0.0189540795981884,
      "pose_mae_dy": 0.02463974431157112,
      "pose_rmse_dtheta": 0.16434010863304138,
      "pose_rmse_dx": 0.050110314041376114,
      "pose_rmse_dy": 0.05713065713644028,
      "pose_rmse_mean": 0.09052702784538269,
      "rmse_dtheta": 0.02082267589867115,
      "rmse_dx": 0.004466550424695015,
      "rmse_dy": 0.004428677260875702,
      "rmse_mean": 0.009905967861413956,
      "rotation_flip": 0.00643776822835207,
      "sparse_tokens": 32089.0,
      "step": 10278,
      "turn_loss": 0.06568636000156403,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4775599330979372,
      "grad_norm": 0.4908655881881714,
      "learning_rate": 5.095131601260517e-07,
      "loss": 0.1269,
      "mae_dtheta": 0.00956661906093359,
      "mae_dx": 0.0019084069645032287,
      "mae_dy": 0.0029657832346856594,
      "pose_mae_dtheta": 0.06761638075113297,
      "pose_mae_dx": 0.027082767337560654,
      "pose_mae_dy": 0.026774615049362183,
      "pose_rmse_dtheta": 0.17219609022140503,
      "pose_rmse_dx": 0.08533108979463577,
      "pose_rmse_dy": 0.06249210983514786,
      "pose_rmse_mean": 0.10667309165000916,
      "rmse_dtheta": 0.02072446420788765,
      "rmse_dx": 0.0053687188774347305,
      "rmse_dy": 0.00731203518807888,
      "rmse_mean": 0.011135073378682137,
      "rotation_flip": 0.003880070522427559,
      "sparse_tokens": 32137.0,
      "step": 10279,
      "turn_loss": 0.08975175768136978,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.47760639286378,
      "grad_norm": 0.5075669884681702,
      "learning_rate": 5.089318095633294e-07,
      "loss": 0.1273,
      "mae_dtheta": 0.009460166096687317,
      "mae_dx": 0.0014680481981486082,
      "mae_dy": 0.0014960927655920386,
      "pose_mae_dtheta": 0.058940913528203964,
      "pose_mae_dx": 0.014158768579363823,
      "pose_mae_dy": 0.016994616016745567,
      "pose_rmse_dtheta": 0.18419203162193298,
      "pose_rmse_dx": 0.03372655808925629,
      "pose_rmse_dy": 0.05001907795667648,
      "pose_rmse_mean": 0.08931255340576172,
      "rmse_dtheta": 0.02529064379632473,
      "rmse_dx": 0.004366816487163305,
      "rmse_dy": 0.004376761149615049,
      "rmse_mean": 0.011344741098582745,
      "rotation_flip": 0.002209456404671073,
      "sparse_tokens": 32169.0,
      "step": 10280,
      "turn_loss": 0.06843618303537369,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.47765285262962276,
      "grad_norm": 1.282038927078247,
      "learning_rate": 5.083507730634152e-07,
      "loss": 0.2486,
      "mae_dtheta": 0.03136703744530678,
      "mae_dx": 0.011078528128564358,
      "mae_dy": 0.0058358232490718365,
      "pose_mae_dtheta": 0.22933070361614227,
      "pose_mae_dx": 0.09089218080043793,
      "pose_mae_dy": 0.0664997398853302,
      "pose_rmse_dtheta": 0.37640464305877686,
      "pose_rmse_dx": 0.19364027678966522,
      "pose_rmse_dy": 0.16861890256404877,
      "pose_rmse_mean": 0.24622128903865814,
      "rmse_dtheta": 0.0475078821182251,
      "rmse_dx": 0.02308190055191517,
      "rmse_dy": 0.012414167635142803,
      "rmse_mean": 0.027667982503771782,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 14538.0,
      "step": 10281,
      "turn_loss": 0.28390663862228394,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.47769931239546554,
      "grad_norm": 0.5256859660148621,
      "learning_rate": 5.077700506669425e-07,
      "loss": 0.1623,
      "mae_dtheta": 0.008262502029538155,
      "mae_dx": 0.001146994880400598,
      "mae_dy": 0.002203078242018819,
      "pose_mae_dtheta": 0.05190801993012428,
      "pose_mae_dx": 0.01766127534210682,
      "pose_mae_dy": 0.027538128197193146,
      "pose_rmse_dtheta": 0.10254239290952682,
      "pose_rmse_dx": 0.047761883586645126,
      "pose_rmse_dy": 0.06443271785974503,
      "pose_rmse_mean": 0.07157900184392929,
      "rmse_dtheta": 0.016162315383553505,
      "rmse_dx": 0.0033944924362003803,
      "rmse_dy": 0.004938837606459856,
      "rmse_mean": 0.008165215142071247,
      "rotation_flip": 0.0027494109235703945,
      "sparse_tokens": 32057.0,
      "step": 10282,
      "turn_loss": 0.0643264651298523,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31142.0,
      "epoch": 0.4777457721613083,
      "grad_norm": 0.6660953760147095,
      "learning_rate": 5.071896424145217e-07,
      "loss": 0.1631,
      "mae_dtheta": 0.03713565319776535,
      "mae_dx": 0.01206300314515829,
      "mae_dy": 0.0061757187359035015,
      "pose_mae_dtheta": 0.2800319790840149,
      "pose_mae_dx": 0.09687040001153946,
      "pose_mae_dy": 0.0682695284485817,
      "pose_rmse_dtheta": 0.5124345421791077,
      "pose_rmse_dx": 0.2020905762910843,
      "pose_rmse_dy": 0.17844325304031372,
      "pose_rmse_mean": 0.2976561188697815,
      "rmse_dtheta": 0.05767125263810158,
      "rmse_dx": 0.023297950625419617,
      "rmse_dy": 0.01412158738821745,
      "rmse_mean": 0.03169693052768707,
      "rotation_flip": 0.011944260448217392,
      "sparse_tokens": 23425.0,
      "step": 10283,
      "turn_loss": 0.3348858058452606,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.4777922319271511,
      "grad_norm": 0.5448192954063416,
      "learning_rate": 5.066095483467404e-07,
      "loss": 0.1815,
      "mae_dtheta": 0.030839797109365463,
      "mae_dx": 0.0065023889765143394,
      "mae_dy": 0.004311883356422186,
      "pose_mae_dtheta": 0.2303827404975891,
      "pose_mae_dx": 0.054717160761356354,
      "pose_mae_dy": 0.05187595263123512,
      "pose_rmse_dtheta": 0.43632471561431885,
      "pose_rmse_dx": 0.11563210934400558,
      "pose_rmse_dy": 0.13231047987937927,
      "pose_rmse_mean": 0.2280890941619873,
      "rmse_dtheta": 0.04950065165758133,
      "rmse_dx": 0.01559498906135559,
      "rmse_dy": 0.008668283000588417,
      "rmse_mean": 0.024587973952293396,
      "rotation_flip": 0.019485579803586006,
      "sparse_tokens": 20273.0,
      "step": 10284,
      "turn_loss": 0.22237689793109894,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.47783869169299387,
      "grad_norm": 0.38346734642982483,
      "learning_rate": 5.06029768504166e-07,
      "loss": 0.1156,
      "mae_dtheta": 0.032731179147958755,
      "mae_dx": 0.009122132323682308,
      "mae_dy": 0.0038989060558378696,
      "pose_mae_dtheta": 0.23338641226291656,
      "pose_mae_dx": 0.0688512995839119,
      "pose_mae_dy": 0.04803510755300522,
      "pose_rmse_dtheta": 0.4108135402202606,
      "pose_rmse_dx": 0.1628183275461197,
      "pose_rmse_dy": 0.10690690577030182,
      "pose_rmse_mean": 0.22684626281261444,
      "rmse_dtheta": 0.05001933127641678,
      "rmse_dx": 0.019969511777162552,
      "rmse_dy": 0.007600719109177589,
      "rmse_mean": 0.02586318925023079,
      "rotation_flip": 0.008130080997943878,
      "sparse_tokens": 18045.0,
      "step": 10285,
      "turn_loss": 0.25893574953079224,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.47788515145883664,
      "grad_norm": 0.4793475866317749,
      "learning_rate": 5.054503029273406e-07,
      "loss": 0.1087,
      "mae_dtheta": 0.021788446232676506,
      "mae_dx": 0.011003542691469193,
      "mae_dy": 0.009606496430933475,
      "pose_mae_dtheta": 0.17531564831733704,
      "pose_mae_dx": 0.0991697758436203,
      "pose_mae_dy": 0.1139233186841011,
      "pose_rmse_dtheta": 0.25730738043785095,
      "pose_rmse_dx": 0.18607205152511597,
      "pose_rmse_dy": 0.21550187468528748,
      "pose_rmse_mean": 0.21962711215019226,
      "rmse_dtheta": 0.03235393390059471,
      "rmse_dx": 0.0214788056910038,
      "rmse_dy": 0.015608482994139194,
      "rmse_mean": 0.02314707450568676,
      "rotation_flip": 0.0117647061124444,
      "sparse_tokens": 3147.0,
      "step": 10286,
      "turn_loss": 0.2989608943462372,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 25235.0,
      "epoch": 0.4779316112246794,
      "grad_norm": 0.4274609088897705,
      "learning_rate": 5.048711516567877e-07,
      "loss": 0.1032,
      "mae_dtheta": 0.030065413564443588,
      "mae_dx": 0.009062657132744789,
      "mae_dy": 0.004474915564060211,
      "pose_mae_dtheta": 0.23905542492866516,
      "pose_mae_dx": 0.081772081553936,
      "pose_mae_dy": 0.05052511766552925,
      "pose_rmse_dtheta": 0.4512556493282318,
      "pose_rmse_dx": 0.19331131875514984,
      "pose_rmse_dy": 0.11491924524307251,
      "pose_rmse_mean": 0.25316208600997925,
      "rmse_dtheta": 0.048150185495615005,
      "rmse_dx": 0.02056841552257538,
      "rmse_dy": 0.009125660173594952,
      "rmse_mean": 0.025948084890842438,
      "rotation_flip": 0.01924927905201912,
      "sparse_tokens": 20290.0,
      "step": 10287,
      "turn_loss": 0.25366970896720886,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 2302.0,
      "epoch": 0.4779780709905222,
      "grad_norm": 0.3723919987678528,
      "learning_rate": 5.042923147330098e-07,
      "loss": 0.079,
      "mae_dtheta": 0.03722403943538666,
      "mae_dx": 0.007044909056276083,
      "mae_dy": 0.008448999375104904,
      "pose_mae_dtheta": 0.2477327287197113,
      "pose_mae_dx": 0.05507921054959297,
      "pose_mae_dy": 0.07781023532152176,
      "pose_rmse_dtheta": 0.43126362562179565,
      "pose_rmse_dx": 0.1371556520462036,
      "pose_rmse_dy": 0.1515589952468872,
      "pose_rmse_mean": 0.23999276757240295,
      "rmse_dtheta": 0.05307002365589142,
      "rmse_dx": 0.016619427129626274,
      "rmse_dy": 0.013784165494143963,
      "rmse_mean": 0.027824539691209793,
      "rotation_flip": 0.008547008968889713,
      "sparse_tokens": 1970.0,
      "step": 10288,
      "turn_loss": 0.2905030846595764,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.478024530756365,
      "grad_norm": 0.8810988068580627,
      "learning_rate": 5.037137921964814e-07,
      "loss": 0.2017,
      "mae_dtheta": 0.03494748845696449,
      "mae_dx": 0.009424425661563873,
      "mae_dy": 0.005347030237317085,
      "pose_mae_dtheta": 0.2490829974412918,
      "pose_mae_dx": 0.05495092645287514,
      "pose_mae_dy": 0.0687619000673294,
      "pose_rmse_dtheta": 0.40015944838523865,
      "pose_rmse_dx": 0.12408755719661713,
      "pose_rmse_dy": 0.13337185978889465,
      "pose_rmse_mean": 0.219206303358078,
      "rmse_dtheta": 0.05030200630426407,
      "rmse_dx": 0.021616825833916664,
      "rmse_dy": 0.00908327754586935,
      "rmse_mean": 0.027000702917575836,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 3956.0,
      "step": 10289,
      "turn_loss": 0.25398582220077515,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.47807099052220775,
      "grad_norm": 0.38296419382095337,
      "learning_rate": 5.031355840876623e-07,
      "loss": 0.0651,
      "mae_dtheta": 0.030205130577087402,
      "mae_dx": 0.0030625280924141407,
      "mae_dy": 0.005510085262358189,
      "pose_mae_dtheta": 0.23645469546318054,
      "pose_mae_dx": 0.04096405953168869,
      "pose_mae_dy": 0.07710029929876328,
      "pose_rmse_dtheta": 0.4399843215942383,
      "pose_rmse_dx": 0.09818285703659058,
      "pose_rmse_dy": 0.1480136513710022,
      "pose_rmse_mean": 0.22872695326805115,
      "rmse_dtheta": 0.048025477677583694,
      "rmse_dx": 0.007157814688980579,
      "rmse_dy": 0.009849121794104576,
      "rmse_mean": 0.021677471697330475,
      "rotation_flip": 0.009740259498357773,
      "sparse_tokens": 5071.0,
      "step": 10290,
      "turn_loss": 0.25669553875923157,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 35254.0,
      "epoch": 0.4781174502880505,
      "grad_norm": 0.42076513171195984,
      "learning_rate": 5.025576904469842e-07,
      "loss": 0.1578,
      "mae_dtheta": 0.03009405918419361,
      "mae_dx": 0.013347135856747627,
      "mae_dy": 0.006182956043630838,
      "pose_mae_dtheta": 0.22780394554138184,
      "pose_mae_dx": 0.10606247186660767,
      "pose_mae_dy": 0.06969043612480164,
      "pose_rmse_dtheta": 0.39615771174430847,
      "pose_rmse_dx": 0.23931168019771576,
      "pose_rmse_dy": 0.167943075299263,
      "pose_rmse_mean": 0.2678041458129883,
      "rmse_dtheta": 0.045562345534563065,
      "rmse_dx": 0.026514526456594467,
      "rmse_dy": 0.012435995042324066,
      "rmse_mean": 0.028170956298708916,
      "rotation_flip": 0.011487303301692009,
      "sparse_tokens": 28485.0,
      "step": 10291,
      "turn_loss": 0.28874945640563965,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.4781639100538933,
      "grad_norm": 0.6582220196723938,
      "learning_rate": 5.01980111314862e-07,
      "loss": 0.1817,
      "mae_dtheta": 0.03034406527876854,
      "mae_dx": 0.01137896440923214,
      "mae_dy": 0.004380618687719107,
      "pose_mae_dtheta": 0.21205773949623108,
      "pose_mae_dx": 0.08978889882564545,
      "pose_mae_dy": 0.0626467913389206,
      "pose_rmse_dtheta": 0.37591123580932617,
      "pose_rmse_dx": 0.21167704463005066,
      "pose_rmse_dy": 0.11566007137298584,
      "pose_rmse_mean": 0.23441612720489502,
      "rmse_dtheta": 0.04532061517238617,
      "rmse_dx": 0.022709932178258896,
      "rmse_dy": 0.007344345096498728,
      "rmse_mean": 0.025124965235590935,
      "rotation_flip": 0.012048192322254181,
      "sparse_tokens": 4996.0,
      "step": 10292,
      "turn_loss": 0.26597654819488525,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.4782103698197361,
      "grad_norm": 0.38033562898635864,
      "learning_rate": 5.014028467316834e-07,
      "loss": 0.0754,
      "mae_dtheta": 0.0339844673871994,
      "mae_dx": 0.0093211205676198,
      "mae_dy": 0.007937579415738583,
      "pose_mae_dtheta": 0.2663283050060272,
      "pose_mae_dx": 0.07134579122066498,
      "pose_mae_dy": 0.07071266323328018,
      "pose_rmse_dtheta": 0.4687999188899994,
      "pose_rmse_dx": 0.1629982590675354,
      "pose_rmse_dy": 0.15527260303497314,
      "pose_rmse_mean": 0.2623569369316101,
      "rmse_dtheta": 0.051852304488420486,
      "rmse_dx": 0.019933348521590233,
      "rmse_dy": 0.01622505486011505,
      "rmse_mean": 0.029336903244256973,
      "rotation_flip": 0.015455950982868671,
      "sparse_tokens": 10658.0,
      "step": 10293,
      "turn_loss": 0.3206024169921875,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4782568295855789,
      "grad_norm": 0.43432602286338806,
      "learning_rate": 5.008258967378188e-07,
      "loss": 0.0779,
      "mae_dtheta": 0.00790279172360897,
      "mae_dx": 0.0014945672592148185,
      "mae_dy": 0.0011649426305666566,
      "pose_mae_dtheta": 0.0561300627887249,
      "pose_mae_dx": 0.010792712680995464,
      "pose_mae_dy": 0.013954425230622292,
      "pose_rmse_dtheta": 0.20626093447208405,
      "pose_rmse_dx": 0.0295867882668972,
      "pose_rmse_dy": 0.04043439030647278,
      "pose_rmse_mean": 0.0920940488576889,
      "rmse_dtheta": 0.025215687230229378,
      "rmse_dx": 0.005511611700057983,
      "rmse_dy": 0.004180912394076586,
      "rmse_mean": 0.011636070907115936,
      "rotation_flip": 0.003017501439899206,
      "sparse_tokens": 32105.0,
      "step": 10294,
      "turn_loss": 0.06428679823875427,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4783032893514217,
      "grad_norm": 0.43384063243865967,
      "learning_rate": 5.002492613736149e-07,
      "loss": 0.1134,
      "mae_dtheta": 0.013998953625559807,
      "mae_dx": 0.002191463951021433,
      "mae_dy": 0.0032648430205881596,
      "pose_mae_dtheta": 0.09416825324296951,
      "pose_mae_dx": 0.028690846636891365,
      "pose_mae_dy": 0.03244240954518318,
      "pose_rmse_dtheta": 0.22112177312374115,
      "pose_rmse_dx": 0.06673622131347656,
      "pose_rmse_dy": 0.06587988138198853,
      "pose_rmse_mean": 0.11791263520717621,
      "rmse_dtheta": 0.027154142037034035,
      "rmse_dx": 0.007131084334105253,
      "rmse_dy": 0.0064522200264036655,
      "rmse_mean": 0.013579148799180984,
      "rotation_flip": 0.004048583097755909,
      "sparse_tokens": 32105.0,
      "step": 10295,
      "turn_loss": 0.11082030087709427,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.47834974911726447,
      "grad_norm": 0.7069584131240845,
      "learning_rate": 4.996729406793943e-07,
      "loss": 0.1278,
      "mae_dtheta": 0.03544485941529274,
      "mae_dx": 0.008694984018802643,
      "mae_dy": 0.0037763987202197313,
      "pose_mae_dtheta": 0.24889828264713287,
      "pose_mae_dx": 0.05883144587278366,
      "pose_mae_dy": 0.05252818763256073,
      "pose_rmse_dtheta": 0.43654054403305054,
      "pose_rmse_dx": 0.13077867031097412,
      "pose_rmse_dy": 0.11934269964694977,
      "pose_rmse_mean": 0.22888730466365814,
      "rmse_dtheta": 0.052287448197603226,
      "rmse_dx": 0.01870667189359665,
      "rmse_dy": 0.006848698481917381,
      "rmse_mean": 0.025947608053684235,
      "rotation_flip": 0.009416195563971996,
      "sparse_tokens": 9620.0,
      "step": 10296,
      "turn_loss": 0.2708388864994049,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47839620888310724,
      "grad_norm": 0.7550768852233887,
      "learning_rate": 4.990969346954611e-07,
      "loss": 0.1457,
      "mae_dtheta": 0.00939083006232977,
      "mae_dx": 0.0018676251638680696,
      "mae_dy": 0.002508539939299226,
      "pose_mae_dtheta": 0.06448234617710114,
      "pose_mae_dx": 0.0222286619246006,
      "pose_mae_dy": 0.020757444202899933,
      "pose_rmse_dtheta": 0.20277242362499237,
      "pose_rmse_dx": 0.06124673783779144,
      "pose_rmse_dy": 0.051388952881097794,
      "pose_rmse_mean": 0.10513603687286377,
      "rmse_dtheta": 0.023544074967503548,
      "rmse_dx": 0.005515153985470533,
      "rmse_dy": 0.006230516824871302,
      "rmse_mean": 0.011763248592615128,
      "rotation_flip": 0.0023310023825615644,
      "sparse_tokens": 32121.0,
      "step": 10297,
      "turn_loss": 0.07645931839942932,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.47844266864895,
      "grad_norm": 0.5632190108299255,
      "learning_rate": 4.985212434620945e-07,
      "loss": 0.1656,
      "mae_dtheta": 0.016476847231388092,
      "mae_dx": 0.004995066672563553,
      "mae_dy": 0.00658663222566247,
      "pose_mae_dtheta": 0.11824800819158554,
      "pose_mae_dx": 0.05246080830693245,
      "pose_mae_dy": 0.048459768295288086,
      "pose_rmse_dtheta": 0.2572632431983948,
      "pose_rmse_dx": 0.13203135132789612,
      "pose_rmse_dy": 0.1072700172662735,
      "pose_rmse_mean": 0.1655215471982956,
      "rmse_dtheta": 0.03116546757519245,
      "rmse_dx": 0.011533503420650959,
      "rmse_dy": 0.014138482511043549,
      "rmse_mean": 0.01894581876695156,
      "rotation_flip": 0.007819831371307373,
      "sparse_tokens": 32153.0,
      "step": 10298,
      "turn_loss": 0.19348984956741333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.4784891284147928,
      "grad_norm": 0.5375621914863586,
      "learning_rate": 4.979458670195542e-07,
      "loss": 0.1458,
      "mae_dtheta": 0.03110649809241295,
      "mae_dx": 0.00949379988014698,
      "mae_dy": 0.007186342030763626,
      "pose_mae_dtheta": 0.1781691163778305,
      "pose_mae_dx": 0.057681672275066376,
      "pose_mae_dy": 0.09753512591123581,
      "pose_rmse_dtheta": 0.2801297903060913,
      "pose_rmse_dx": 0.13416525721549988,
      "pose_rmse_dy": 0.18043623864650726,
      "pose_rmse_mean": 0.19824376702308655,
      "rmse_dtheta": 0.04278658330440521,
      "rmse_dx": 0.021038131788372993,
      "rmse_dy": 0.01030915416777134,
      "rmse_mean": 0.024711288511753082,
      "rotation_flip": 0.004065040498971939,
      "sparse_tokens": 4357.0,
      "step": 10299,
      "turn_loss": 0.28049635887145996,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 33088.0,
      "epoch": 0.4785355881806356,
      "grad_norm": 0.4615173637866974,
      "learning_rate": 4.97370805408075e-07,
      "loss": 0.1587,
      "mae_dtheta": 0.03604533523321152,
      "mae_dx": 0.010697105899453163,
      "mae_dy": 0.005616735201328993,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.46151742339134216,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.00909423828125,
      "model/head/act_norm_mean": 99.5731081495098,
      "model/head/act_norm_min": 68.28607177734375,
      "model/head/act_over_embed": 68.42757213846897,
      "model/head/grad_frac": 0.11889442801475525,
      "model/head/grad_norm": 0.054871849715709686,
      "model/head/grad_zero_frac": 0.00018401762645225972,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6854990042892157,
      "model/head/update_ratio": 0.0009341249242424965,
      "model/head/weight_delta": 9.962766647338867,
      "model/head/weight_delta_rel": 0.17477643489837646,
      "model/head/weight_norm": 58.74144744873047,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42284518480300903,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227887496207524,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42273539304733276,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905443869500176,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08798082172870636,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04060468077659607,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5264335558252428,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013111070729792118,
      "model/modality_embedder.encoders.pose/weight_delta": 3.151136875152588,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10295746475458145,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96976661682129,
      "model/modality_embedder/grad_frac": 0.08798082172870636,
      "model/modality_embedder/grad_norm": 0.04060468077659607,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5264335558252428,
      "model/modality_embedder/update_ratio": 0.0013111070729792118,
      "model/modality_embedder/weight_delta": 3.151136875152588,
      "model/modality_embedder/weight_delta_rel": 0.10295746475458145,
      "model/modality_embedder/weight_norm": 30.96976661682129,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 82.4429931640625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.697111830843447,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.162176132202148,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.59766774386447,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08204317092895508,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03786435350775719,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001354309031739831,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7301547527313232,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09948848932981491,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.95842933654785,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.87501525878906,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.51907533846872,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.543023109436035,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.162528761648158,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08727394789457321,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.040278445929288864,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001353149302303791,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4617395401000977,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1199173629283905,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.766447067260742,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.88262176513672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.177022545129162,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.09649658203125,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.301885604011517,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08320585638284683,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03840095177292824,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001249307650141418,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7496755123138428,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1259070783853531,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.73778533935547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.6330795288086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.01491985683162,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.973075866699219,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.564905843279174,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.072112537920475,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03328119218349457,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001111163292080164,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2218234539031982,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11010663956403732,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95166778564453,
      "model/normalizer/grad_frac": 0.2834983468055725,
      "model/normalizer/grad_norm": 0.13083942234516144,
      "model/normalizer/grad_zero_frac": 0.00020562247664202005,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016635010251775384,
      "model/normalizer/weight_delta": 6.778143882751465,
      "model/normalizer/weight_delta_rel": 0.08729857206344604,
      "model/normalizer/weight_norm": 78.65304565429688,
      "pose_mae_dtheta": 0.2936254143714905,
      "pose_mae_dx": 0.08707207441329956,
      "pose_mae_dy": 0.052205465734004974,
      "pose_rmse_dtheta": 0.521211564540863,
      "pose_rmse_dx": 0.19088490307331085,
      "pose_rmse_dy": 0.14733999967575073,
      "pose_rmse_mean": 0.28647881746292114,
      "rmse_dtheta": 0.05581227317452431,
      "rmse_dx": 0.022162267938256264,
      "rmse_dy": 0.01312478631734848,
      "rmse_mean": 0.0303664430975914,
      "rotation_flip": 0.013019219040870667,
      "sparse_tokens": 27132.0,
      "step": 10300,
      "turn_loss": 0.3408989906311035,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.47858204794647835,
      "grad_norm": 0.8341031670570374,
      "learning_rate": 4.967960586678722e-07,
      "loss": 0.28,
      "mae_dtheta": 0.037054408341646194,
      "mae_dx": 0.008455720730125904,
      "mae_dy": 0.002814620966091752,
      "pose_mae_dtheta": 0.30541324615478516,
      "pose_mae_dx": 0.07275141030550003,
      "pose_mae_dy": 0.04057830199599266,
      "pose_rmse_dtheta": 0.5858650803565979,
      "pose_rmse_dx": 0.18758605420589447,
      "pose_rmse_dy": 0.10461074858903885,
      "pose_rmse_mean": 0.2926872968673706,
      "rmse_dtheta": 0.05969904363155365,
      "rmse_dx": 0.020069502294063568,
      "rmse_dy": 0.0063085793517529964,
      "rmse_mean": 0.028692375868558884,
      "rotation_flip": 0.00826446246355772,
      "sparse_tokens": 10121.0,
      "step": 10301,
      "turn_loss": 0.17388689517974854,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4786285077123211,
      "grad_norm": 0.4631763696670532,
      "learning_rate": 4.962216268391384e-07,
      "loss": 0.1233,
      "mae_dtheta": 0.011156465858221054,
      "mae_dx": 0.0018023813609033823,
      "mae_dy": 0.002779749222099781,
      "pose_mae_dtheta": 0.07693029940128326,
      "pose_mae_dx": 0.025522254407405853,
      "pose_mae_dy": 0.03564075753092766,
      "pose_rmse_dtheta": 0.16026033461093903,
      "pose_rmse_dx": 0.06579527258872986,
      "pose_rmse_dy": 0.07865174114704132,
      "pose_rmse_mean": 0.10156911611557007,
      "rmse_dtheta": 0.02313564158976078,
      "rmse_dx": 0.00570011418312788,
      "rmse_dy": 0.006834990344941616,
      "rmse_mean": 0.011890249326825142,
      "rotation_flip": 0.0015191796701401472,
      "sparse_tokens": 32057.0,
      "step": 10302,
      "turn_loss": 0.08857724815607071,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4786749674781639,
      "grad_norm": 0.4029361605644226,
      "learning_rate": 4.956475099620433e-07,
      "loss": 0.0826,
      "mae_dtheta": 0.009039519354701042,
      "mae_dx": 0.0022050493862479925,
      "mae_dy": 0.0018086107447743416,
      "pose_mae_dtheta": 0.05975630506873131,
      "pose_mae_dx": 0.0223538801074028,
      "pose_mae_dy": 0.023061497136950493,
      "pose_rmse_dtheta": 0.17595887184143066,
      "pose_rmse_dx": 0.05699286237359047,
      "pose_rmse_dy": 0.04836324229836464,
      "pose_rmse_mean": 0.09377165883779526,
      "rmse_dtheta": 0.021951919421553612,
      "rmse_dx": 0.007166820578277111,
      "rmse_dy": 0.003495575860142708,
      "rmse_mean": 0.010871438309550285,
      "rotation_flip": 0.002316960133612156,
      "sparse_tokens": 32073.0,
      "step": 10303,
      "turn_loss": 0.09895271062850952,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4787214272440067,
      "grad_norm": 0.3597411811351776,
      "learning_rate": 4.950737080767359e-07,
      "loss": 0.1019,
      "mae_dtheta": 0.006723432336002588,
      "mae_dx": 0.0019247103482484818,
      "mae_dy": 0.0016804225742816925,
      "pose_mae_dtheta": 0.04636017978191376,
      "pose_mae_dx": 0.017777318134903908,
      "pose_mae_dy": 0.012355259619653225,
      "pose_rmse_dtheta": 0.1825598180294037,
      "pose_rmse_dx": 0.0533573292195797,
      "pose_rmse_dy": 0.03357141464948654,
      "pose_rmse_mean": 0.08982952684164047,
      "rmse_dtheta": 0.021558405831456184,
      "rmse_dx": 0.007077432237565517,
      "rmse_dy": 0.0056939153000712395,
      "rmse_mean": 0.011443251743912697,
      "rotation_flip": 0.0018231540452688932,
      "sparse_tokens": 32121.0,
      "step": 10304,
      "turn_loss": 0.06436941772699356,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.47876788700984946,
      "grad_norm": 0.9140821695327759,
      "learning_rate": 4.945002212233412e-07,
      "loss": 0.178,
      "mae_dtheta": 0.02680209092795849,
      "mae_dx": 0.013871303759515285,
      "mae_dy": 0.005040552467107773,
      "pose_mae_dtheta": 0.19016335904598236,
      "pose_mae_dx": 0.0979585126042366,
      "pose_mae_dy": 0.04630647972226143,
      "pose_rmse_dtheta": 0.3873746991157532,
      "pose_rmse_dx": 0.22930613160133362,
      "pose_rmse_dy": 0.10447130352258682,
      "pose_rmse_mean": 0.2403840720653534,
      "rmse_dtheta": 0.04687422886490822,
      "rmse_dx": 0.02664961665868759,
      "rmse_dy": 0.011300727725028992,
      "rmse_mean": 0.028274860233068466,
      "rotation_flip": 0.011594203300774097,
      "sparse_tokens": 7235.0,
      "step": 10305,
      "turn_loss": 0.3151816725730896,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.47881434677569223,
      "grad_norm": 0.4717547595500946,
      "learning_rate": 4.939270494419657e-07,
      "loss": 0.1022,
      "mae_dtheta": 0.009358331561088562,
      "mae_dx": 0.0015013560187071562,
      "mae_dy": 0.0024944175966084003,
      "pose_mae_dtheta": 0.05325455218553543,
      "pose_mae_dx": 0.016703540459275246,
      "pose_mae_dy": 0.0260785985738039,
      "pose_rmse_dtheta": 0.1392381340265274,
      "pose_rmse_dx": 0.042467303574085236,
      "pose_rmse_dy": 0.055803898721933365,
      "pose_rmse_mean": 0.07916978001594543,
      "rmse_dtheta": 0.020212016999721527,
      "rmse_dx": 0.0036842466797679663,
      "rmse_dy": 0.00538789015263319,
      "rmse_mean": 0.009761384688317776,
      "rotation_flip": 0.006969797424972057,
      "sparse_tokens": 32153.0,
      "step": 10306,
      "turn_loss": 0.07976173609495163,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.478860806541535,
      "grad_norm": 0.3282207250595093,
      "learning_rate": 4.933541927726887e-07,
      "loss": 0.0694,
      "mae_dtheta": 0.006523004733026028,
      "mae_dx": 0.0013275820529088378,
      "mae_dy": 0.0010603427654132247,
      "pose_mae_dtheta": 0.04852444678544998,
      "pose_mae_dx": 0.013495651073753834,
      "pose_mae_dy": 0.016093876212835312,
      "pose_rmse_dtheta": 0.15013694763183594,
      "pose_rmse_dx": 0.04038466513156891,
      "pose_rmse_dy": 0.05207115411758423,
      "pose_rmse_mean": 0.08086425811052322,
      "rmse_dtheta": 0.01984274387359619,
      "rmse_dx": 0.004901661071926355,
      "rmse_dy": 0.0035436737816780806,
      "rmse_mean": 0.009429359808564186,
      "rotation_flip": 0.0018785222200676799,
      "sparse_tokens": 32089.0,
      "step": 10307,
      "turn_loss": 0.04314118251204491,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.4789072663073778,
      "grad_norm": 0.6426745653152466,
      "learning_rate": 4.927816512555733e-07,
      "loss": 0.1651,
      "mae_dtheta": 0.0329805426299572,
      "mae_dx": 0.010958144441246986,
      "mae_dy": 0.005091485567390919,
      "pose_mae_dtheta": 0.2885597050189972,
      "pose_mae_dx": 0.09171764552593231,
      "pose_mae_dy": 0.06487340480089188,
      "pose_rmse_dtheta": 0.5234149098396301,
      "pose_rmse_dx": 0.19463907182216644,
      "pose_rmse_dy": 0.139576256275177,
      "pose_rmse_mean": 0.2858767509460449,
      "rmse_dtheta": 0.05062981694936752,
      "rmse_dx": 0.022426031529903412,
      "rmse_dy": 0.009935804642736912,
      "rmse_mean": 0.027663884684443474,
      "rotation_flip": 0.020964359864592552,
      "sparse_tokens": 9268.0,
      "step": 10308,
      "turn_loss": 0.2534690499305725,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.47895372607322056,
      "grad_norm": 0.4329836666584015,
      "learning_rate": 4.922094249306559e-07,
      "loss": 0.1042,
      "mae_dtheta": 0.008789261803030968,
      "mae_dx": 0.0015760167734697461,
      "mae_dy": 0.0020927477162331343,
      "pose_mae_dtheta": 0.056428126990795135,
      "pose_mae_dx": 0.017869798466563225,
      "pose_mae_dy": 0.021554866805672646,
      "pose_rmse_dtheta": 0.13316114246845245,
      "pose_rmse_dx": 0.05070307478308678,
      "pose_rmse_dy": 0.051126569509506226,
      "pose_rmse_mean": 0.07833026349544525,
      "rmse_dtheta": 0.020041098818182945,
      "rmse_dx": 0.005012860521674156,
      "rmse_dy": 0.0054089948534965515,
      "rmse_mean": 0.010154318064451218,
      "rotation_flip": 0.0040716612711548805,
      "sparse_tokens": 32105.0,
      "step": 10309,
      "turn_loss": 0.07584256678819656,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.4790001858390634,
      "grad_norm": 0.4872283339500427,
      "learning_rate": 4.91637513837952e-07,
      "loss": 0.0961,
      "mae_dtheta": 0.027650339528918266,
      "mae_dx": 0.004150508437305689,
      "mae_dy": 0.0027321509551256895,
      "pose_mae_dtheta": 0.2034420371055603,
      "pose_mae_dx": 0.03767625615000725,
      "pose_mae_dy": 0.036886442452669144,
      "pose_rmse_dtheta": 0.4005977511405945,
      "pose_rmse_dx": 0.09049545973539352,
      "pose_rmse_dy": 0.08498349785804749,
      "pose_rmse_mean": 0.1920255869626999,
      "rmse_dtheta": 0.04784736409783363,
      "rmse_dx": 0.010598904453217983,
      "rmse_dy": 0.006178732495754957,
      "rmse_mean": 0.021541668102145195,
      "rotation_flip": 0.010940918698906898,
      "sparse_tokens": 7987.0,
      "step": 10310,
      "turn_loss": 0.1569637656211853,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.4790466456049062,
      "grad_norm": 0.3795928955078125,
      "learning_rate": 4.910659180174571e-07,
      "loss": 0.0773,
      "mae_dtheta": 0.04128897935152054,
      "mae_dx": 0.013945943675935268,
      "mae_dy": 0.0037510856054723263,
      "pose_mae_dtheta": 0.3105927109718323,
      "pose_mae_dx": 0.1178148090839386,
      "pose_mae_dy": 0.03800550103187561,
      "pose_rmse_dtheta": 0.5036410093307495,
      "pose_rmse_dx": 0.26274749636650085,
      "pose_rmse_dy": 0.08308795839548111,
      "pose_rmse_mean": 0.2831588387489319,
      "rmse_dtheta": 0.05985487252473831,
      "rmse_dx": 0.027621915563941002,
      "rmse_dy": 0.007920226082205772,
      "rmse_mean": 0.03179900720715523,
      "rotation_flip": 0.013645224273204803,
      "sparse_tokens": 8294.0,
      "step": 10311,
      "turn_loss": 0.2752988636493683,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.47909310537074895,
      "grad_norm": 0.483819842338562,
      "learning_rate": 4.904946375091424e-07,
      "loss": 0.0748,
      "mae_dtheta": 0.008478378877043724,
      "mae_dx": 0.0018496678676456213,
      "mae_dy": 0.0022430792450904846,
      "pose_mae_dtheta": 0.06184273958206177,
      "pose_mae_dx": 0.01492436695843935,
      "pose_mae_dy": 0.016358908265829086,
      "pose_rmse_dtheta": 0.19535398483276367,
      "pose_rmse_dx": 0.043587759137153625,
      "pose_rmse_dy": 0.04273241013288498,
      "pose_rmse_mean": 0.09389138221740723,
      "rmse_dtheta": 0.023039599880576134,
      "rmse_dx": 0.0069898571819067,
      "rmse_dy": 0.007032846100628376,
      "rmse_mean": 0.012354101054370403,
      "rotation_flip": 0.004897595848888159,
      "sparse_tokens": 32137.0,
      "step": 10312,
      "turn_loss": 0.07942485064268112,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4791395651365917,
      "grad_norm": 0.5016762614250183,
      "learning_rate": 4.899236723529576e-07,
      "loss": 0.1395,
      "mae_dtheta": 0.007343893405050039,
      "mae_dx": 0.0013923731166869402,
      "mae_dy": 0.0019281251588836312,
      "pose_mae_dtheta": 0.04642949625849724,
      "pose_mae_dx": 0.018502704799175262,
      "pose_mae_dy": 0.021203259006142616,
      "pose_rmse_dtheta": 0.11787686496973038,
      "pose_rmse_dx": 0.05094713345170021,
      "pose_rmse_dy": 0.056281398981809616,
      "pose_rmse_mean": 0.07503513991832733,
      "rmse_dtheta": 0.018038434907794,
      "rmse_dx": 0.004468720406293869,
      "rmse_dy": 0.004859950393438339,
      "rmse_mean": 0.00912236887961626,
      "rotation_flip": 0.0045095826499164104,
      "sparse_tokens": 32153.0,
      "step": 10313,
      "turn_loss": 0.06669357419013977,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4791860249024345,
      "grad_norm": 0.6086696982383728,
      "learning_rate": 4.893530225888321e-07,
      "loss": 0.0829,
      "mae_dtheta": 0.009864621795713902,
      "mae_dx": 0.0013170879101380706,
      "mae_dy": 0.001998549560084939,
      "pose_mae_dtheta": 0.06333575397729874,
      "pose_mae_dx": 0.01779276877641678,
      "pose_mae_dy": 0.023072445765137672,
      "pose_rmse_dtheta": 0.15285176038742065,
      "pose_rmse_dx": 0.04483581334352493,
      "pose_rmse_dy": 0.04855353757739067,
      "pose_rmse_mean": 0.08208037167787552,
      "rmse_dtheta": 0.021188050508499146,
      "rmse_dx": 0.004164328798651695,
      "rmse_dy": 0.004220282193273306,
      "rmse_mean": 0.009857553988695145,
      "rotation_flip": 0.005231949966400862,
      "sparse_tokens": 32121.0,
      "step": 10314,
      "turn_loss": 0.06757280975580215,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.4792324846682773,
      "grad_norm": 0.6361258029937744,
      "learning_rate": 4.887826882566699e-07,
      "loss": 0.1659,
      "mae_dtheta": 0.04370900243520737,
      "mae_dx": 0.008989695459604263,
      "mae_dy": 0.0052335518412292,
      "pose_mae_dtheta": 0.3500068485736847,
      "pose_mae_dx": 0.0820823386311531,
      "pose_mae_dy": 0.0730600506067276,
      "pose_rmse_dtheta": 0.5672359466552734,
      "pose_rmse_dx": 0.1906418651342392,
      "pose_rmse_dy": 0.16686123609542847,
      "pose_rmse_mean": 0.308246374130249,
      "rmse_dtheta": 0.06081881374120712,
      "rmse_dx": 0.019809044897556305,
      "rmse_dy": 0.010262731462717056,
      "rmse_mean": 0.03029686212539673,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 13808.0,
      "step": 10315,
      "turn_loss": 0.34060609340667725,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.47927894443412006,
      "grad_norm": 0.38545870780944824,
      "learning_rate": 4.882126693963568e-07,
      "loss": 0.1325,
      "mae_dtheta": 0.030893785879015923,
      "mae_dx": 0.012556849978864193,
      "mae_dy": 0.0031168321147561073,
      "pose_mae_dtheta": 0.20854772627353668,
      "pose_mae_dx": 0.08630979061126709,
      "pose_mae_dy": 0.028274523094296455,
      "pose_rmse_dtheta": 0.4337540864944458,
      "pose_rmse_dx": 0.23439650237560272,
      "pose_rmse_dy": 0.06389901787042618,
      "pose_rmse_mean": 0.24401655793190002,
      "rmse_dtheta": 0.05035218596458435,
      "rmse_dx": 0.0273542832583189,
      "rmse_dy": 0.006868600845336914,
      "rmse_mean": 0.028191691264510155,
      "rotation_flip": 0.020408162847161293,
      "sparse_tokens": 4797.0,
      "step": 10316,
      "turn_loss": 0.24058744311332703,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.47932540419996283,
      "grad_norm": 0.46788010001182556,
      "learning_rate": 4.876429660477522e-07,
      "loss": 0.1184,
      "mae_dtheta": 0.02777896635234356,
      "mae_dx": 0.013142482377588749,
      "mae_dy": 0.0053943139500916,
      "pose_mae_dtheta": 0.2072203904390335,
      "pose_mae_dx": 0.10348381847143173,
      "pose_mae_dy": 0.07860210537910461,
      "pose_rmse_dtheta": 0.37396109104156494,
      "pose_rmse_dx": 0.22721517086029053,
      "pose_rmse_dy": 0.1618633270263672,
      "pose_rmse_mean": 0.2543465495109558,
      "rmse_dtheta": 0.04276123642921448,
      "rmse_dx": 0.026509230956435204,
      "rmse_dy": 0.00893352460116148,
      "rmse_mean": 0.02606799826025963,
      "rotation_flip": 0.005755395628511906,
      "sparse_tokens": 13904.0,
      "step": 10317,
      "turn_loss": 0.25445225834846497,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4793718639658056,
      "grad_norm": 0.6065850853919983,
      "learning_rate": 4.87073578250698e-07,
      "loss": 0.1051,
      "mae_dtheta": 0.007882489822804928,
      "mae_dx": 0.0016209764871746302,
      "mae_dy": 0.0016162696992978454,
      "pose_mae_dtheta": 0.04748964309692383,
      "pose_mae_dx": 0.01790573261678219,
      "pose_mae_dy": 0.0188678577542305,
      "pose_rmse_dtheta": 0.10586446523666382,
      "pose_rmse_dx": 0.041250474750995636,
      "pose_rmse_dy": 0.04678146541118622,
      "pose_rmse_mean": 0.06463213264942169,
      "rmse_dtheta": 0.018337247893214226,
      "rmse_dx": 0.004598919302225113,
      "rmse_dy": 0.003750032279640436,
      "rmse_mean": 0.00889539998024702,
      "rotation_flip": 0.006525285542011261,
      "sparse_tokens": 32073.0,
      "step": 10318,
      "turn_loss": 0.08012435585260391,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4794183237316484,
      "grad_norm": 0.4757993221282959,
      "learning_rate": 4.865045060450097e-07,
      "loss": 0.1106,
      "mae_dtheta": 0.0076446752063930035,
      "mae_dx": 0.0010360573651269078,
      "mae_dy": 0.0012128031812608242,
      "pose_mae_dtheta": 0.05591750517487526,
      "pose_mae_dx": 0.009202632121741772,
      "pose_mae_dy": 0.016403283923864365,
      "pose_rmse_dtheta": 0.18661180138587952,
      "pose_rmse_dx": 0.026536142453551292,
      "pose_rmse_dy": 0.04306236281991005,
      "pose_rmse_mean": 0.0854034349322319,
      "rmse_dtheta": 0.02290758118033409,
      "rmse_dx": 0.00423395587131381,
      "rmse_dy": 0.003948834724724293,
      "rmse_mean": 0.010363457724452019,
      "rotation_flip": 0.003638568799942732,
      "sparse_tokens": 32073.0,
      "step": 10319,
      "turn_loss": 0.06411734223365784,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.47946478349749116,
      "grad_norm": 0.40827444195747375,
      "learning_rate": 4.859357494704836e-07,
      "loss": 0.0825,
      "mae_dtheta": 0.01012794952839613,
      "mae_dx": 0.0012851987266913056,
      "mae_dy": 0.0013119691284373403,
      "pose_mae_dtheta": 0.06690014898777008,
      "pose_mae_dx": 0.014165167696774006,
      "pose_mae_dy": 0.01748313196003437,
      "pose_rmse_dtheta": 0.1925293356180191,
      "pose_rmse_dx": 0.030623778700828552,
      "pose_rmse_dy": 0.04509745538234711,
      "pose_rmse_mean": 0.08941686153411865,
      "rmse_dtheta": 0.02543901652097702,
      "rmse_dx": 0.0038551336620002985,
      "rmse_dy": 0.0027048676274716854,
      "rmse_mean": 0.01066633965820074,
      "rotation_flip": 0.004001600667834282,
      "sparse_tokens": 32153.0,
      "step": 10320,
      "turn_loss": 0.07116131484508514,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47951124326333394,
      "grad_norm": 0.4979664981365204,
      "learning_rate": 4.853673085668947e-07,
      "loss": 0.1124,
      "mae_dtheta": 0.009561706334352493,
      "mae_dx": 0.0011915714712813497,
      "mae_dy": 0.0016329766949638724,
      "pose_mae_dtheta": 0.06468182057142258,
      "pose_mae_dx": 0.01745389588177204,
      "pose_mae_dy": 0.024121971800923347,
      "pose_rmse_dtheta": 0.180059015750885,
      "pose_rmse_dx": 0.05260562524199486,
      "pose_rmse_dy": 0.0715845450758934,
      "pose_rmse_mean": 0.10141640156507492,
      "rmse_dtheta": 0.023580851033329964,
      "rmse_dx": 0.0038471799343824387,
      "rmse_dy": 0.003986171912401915,
      "rmse_mean": 0.010471401736140251,
      "rotation_flip": 0.00162601622287184,
      "sparse_tokens": 32121.0,
      "step": 10321,
      "turn_loss": 0.05641428753733635,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17804.0,
      "epoch": 0.4795577030291767,
      "grad_norm": 0.5451288223266602,
      "learning_rate": 4.847991833739918e-07,
      "loss": 0.1401,
      "mae_dtheta": 0.0239726472645998,
      "mae_dx": 0.013215896673500538,
      "mae_dy": 0.0027674539014697075,
      "pose_mae_dtheta": 0.18483573198318481,
      "pose_mae_dx": 0.10529293119907379,
      "pose_mae_dy": 0.0417768768966198,
      "pose_rmse_dtheta": 0.3524520695209503,
      "pose_rmse_dx": 0.25264275074005127,
      "pose_rmse_dy": 0.09929504245519638,
      "pose_rmse_mean": 0.23479661345481873,
      "rmse_dtheta": 0.040710195899009705,
      "rmse_dx": 0.027353350073099136,
      "rmse_dy": 0.005510298069566488,
      "rmse_mean": 0.024524614214897156,
      "rotation_flip": 0.013698630034923553,
      "sparse_tokens": 13567.0,
      "step": 10322,
      "turn_loss": 0.21042612195014954,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4796041627950195,
      "grad_norm": 0.5240544080734253,
      "learning_rate": 4.842313739315063e-07,
      "loss": 0.1392,
      "mae_dtheta": 0.0076772901229560375,
      "mae_dx": 0.0011068248422816396,
      "mae_dy": 0.001430991804227233,
      "pose_mae_dtheta": 0.048048343509435654,
      "pose_mae_dx": 0.014603879302740097,
      "pose_mae_dy": 0.019472986459732056,
      "pose_rmse_dtheta": 0.11985641717910767,
      "pose_rmse_dx": 0.03996976837515831,
      "pose_rmse_dy": 0.05071432515978813,
      "pose_rmse_mean": 0.07018017768859863,
      "rmse_dtheta": 0.018258262425661087,
      "rmse_dx": 0.004285668488591909,
      "rmse_dy": 0.0032822268549352884,
      "rmse_mean": 0.00860871933400631,
      "rotation_flip": 0.003611738095059991,
      "sparse_tokens": 32073.0,
      "step": 10323,
      "turn_loss": 0.05790884792804718,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47965062256086227,
      "grad_norm": 0.4092824459075928,
      "learning_rate": 4.836638802791438e-07,
      "loss": 0.0929,
      "mae_dtheta": 0.011265951208770275,
      "mae_dx": 0.0032431650906801224,
      "mae_dy": 0.004629978444427252,
      "pose_mae_dtheta": 0.07424439489841461,
      "pose_mae_dx": 0.039777737110853195,
      "pose_mae_dy": 0.03853941708803177,
      "pose_rmse_dtheta": 0.14307045936584473,
      "pose_rmse_dx": 0.09058524668216705,
      "pose_rmse_dy": 0.08075153082609177,
      "pose_rmse_mean": 0.10480241477489471,
      "rmse_dtheta": 0.020653117448091507,
      "rmse_dx": 0.007671786472201347,
      "rmse_dy": 0.009557981975376606,
      "rmse_mean": 0.012627629563212395,
      "rotation_flip": 0.005621486343443394,
      "sparse_tokens": 32121.0,
      "step": 10324,
      "turn_loss": 0.15575644373893738,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47969708232670505,
      "grad_norm": 0.35515227913856506,
      "learning_rate": 4.830967024565908e-07,
      "loss": 0.0814,
      "mae_dtheta": 0.00976028386503458,
      "mae_dx": 0.0013781334273517132,
      "mae_dy": 0.0016785028856247663,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3551522195339203,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.07958984375,
      "model/head/act_norm_mean": 112.33260337752525,
      "model/head/act_norm_min": 51.50669479370117,
      "model/head/act_over_embed": 77.19601671543757,
      "model/head/grad_frac": 0.10351043939590454,
      "model/head/grad_norm": 0.03676196187734604,
      "model/head/grad_zero_frac": 0.00021891752840019763,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7060645517676768,
      "model/head/update_ratio": 0.0006258242065086961,
      "model/head/weight_delta": 9.96377944946289,
      "model/head/weight_delta_rel": 0.17479419708251953,
      "model/head/weight_norm": 58.741676330566406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228675663471222,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227918158637153,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227265417575836,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29054649410088834,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12171889841556549,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04322873800992966,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5204513888888889,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013958353083580732,
      "model/modality_embedder.encoders.pose/weight_delta": 3.151712417602539,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10297627002000809,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969797134399414,
      "model/modality_embedder/grad_frac": 0.12171889841556549,
      "model/modality_embedder/grad_norm": 0.04322873800992966,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5204513888888889,
      "model/modality_embedder/update_ratio": 0.0013958353083580732,
      "model/modality_embedder/weight_delta": 3.151712417602539,
      "model/modality_embedder/weight_delta_rel": 0.10297627002000809,
      "model/modality_embedder/weight_norm": 30.969797134399414,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 93.62923431396484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.824194324194323,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.01363754272461,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.372209385207743,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06482432037591934,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.023022500798106194,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008234495180658996,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.730720281600952,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.099509097635746,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.958606719970703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 95.37203216552734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.797431156806155,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.186723709106445,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.041026848165377,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06556243449449539,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02328464388847351,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007822390762157738,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.462390899658203,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11993992328643799,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.766658782958984,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 97.2981948852539,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.56525072150072,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.491551399230957,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.255889003611006,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06138642504811287,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.021801525726914406,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007092697196640074,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.750438690185547,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1259327083826065,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.73798942565918,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 98.47966003417969,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.2601911976912,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.284104347229004,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.42066796713185,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.061122819781303406,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02170790545642376,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007247591856867075,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.222571611404419,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11013220250606537,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.951887130737305,
      "model/normalizer/grad_frac": 0.24395054578781128,
      "model/normalizer/grad_norm": 0.08663957566022873,
      "model/normalizer/grad_zero_frac": 0.00025998245109803975,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0011015379568561912,
      "model/normalizer/weight_delta": 6.779536247253418,
      "model/normalizer/weight_delta_rel": 0.08731649816036224,
      "model/normalizer/weight_norm": 78.65328216552734,
      "pose_mae_dtheta": 0.058664605021476746,
      "pose_mae_dx": 0.016002612188458443,
      "pose_mae_dy": 0.020349614322185516,
      "pose_rmse_dtheta": 0.16064777970314026,
      "pose_rmse_dx": 0.039807792752981186,
      "pose_rmse_dy": 0.04469592869281769,
      "pose_rmse_mean": 0.08171717077493668,
      "rmse_dtheta": 0.02189626358449459,
      "rmse_dx": 0.004248203244060278,
      "rmse_dy": 0.0035730900708585978,
      "rmse_mean": 0.009905852377414703,
      "rotation_flip": 0.0019179133232682943,
      "sparse_tokens": 32121.0,
      "step": 10325,
      "turn_loss": 0.06691211462020874,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4797435420925479,
      "grad_norm": 0.3804566264152527,
      "learning_rate": 4.8252984050351e-07,
      "loss": 0.085,
      "mae_dtheta": 0.008695250377058983,
      "mae_dx": 0.0023470562882721424,
      "mae_dy": 0.002161098876968026,
      "pose_mae_dtheta": 0.06067284196615219,
      "pose_mae_dx": 0.02217557467520237,
      "pose_mae_dy": 0.016649041324853897,
      "pose_rmse_dtheta": 0.2076546996831894,
      "pose_rmse_dx": 0.05976466089487076,
      "pose_rmse_dy": 0.04067933186888695,
      "pose_rmse_mean": 0.10269957035779953,
      "rmse_dtheta": 0.0240486953407526,
      "rmse_dx": 0.0066407485865056515,
      "rmse_dy": 0.005742133595049381,
      "rmse_mean": 0.012143859639763832,
      "rotation_flip": 0.002051702933385968,
      "sparse_tokens": 32169.0,
      "step": 10326,
      "turn_loss": 0.08542511612176895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.47979000185839066,
      "grad_norm": 0.3834947347640991,
      "learning_rate": 4.819632944595415e-07,
      "loss": 0.1247,
      "mae_dtheta": 0.008669809438288212,
      "mae_dx": 0.0012455071555450559,
      "mae_dy": 0.001892936765216291,
      "pose_mae_dtheta": 0.055870525538921356,
      "pose_mae_dx": 0.01894419826567173,
      "pose_mae_dy": 0.02339320443570614,
      "pose_rmse_dtheta": 0.15762923657894135,
      "pose_rmse_dx": 0.046191055327653885,
      "pose_rmse_dy": 0.05437939614057541,
      "pose_rmse_mean": 0.08606656640768051,
      "rmse_dtheta": 0.02101939544081688,
      "rmse_dx": 0.0029792834538966417,
      "rmse_dy": 0.004094835836440325,
      "rmse_mean": 0.009364505298435688,
      "rotation_flip": 0.0015094339614734054,
      "sparse_tokens": 32137.0,
      "step": 10327,
      "turn_loss": 0.0703587681055069,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.47983646162423343,
      "grad_norm": 0.31987473368644714,
      "learning_rate": 4.813970643643057e-07,
      "loss": 0.0626,
      "mae_dtheta": 0.028972357511520386,
      "mae_dx": 0.00989355705678463,
      "mae_dy": 0.003620718838647008,
      "pose_mae_dtheta": 0.2566676735877991,
      "pose_mae_dx": 0.08905103802680969,
      "pose_mae_dy": 0.03907933831214905,
      "pose_rmse_dtheta": 0.45028477907180786,
      "pose_rmse_dx": 0.19358830153942108,
      "pose_rmse_dy": 0.1013367623090744,
      "pose_rmse_mean": 0.24840329587459564,
      "rmse_dtheta": 0.046231672167778015,
      "rmse_dx": 0.02096002735197544,
      "rmse_dy": 0.007163571659475565,
      "rmse_mean": 0.02478509023785591,
      "rotation_flip": 0.018633540719747543,
      "sparse_tokens": 11451.0,
      "step": 10328,
      "turn_loss": 0.21100099384784698,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.4798829213900762,
      "grad_norm": 0.6197648048400879,
      "learning_rate": 4.808311502573976e-07,
      "loss": 0.1605,
      "mae_dtheta": 0.031048819422721863,
      "mae_dx": 0.010306484997272491,
      "mae_dy": 0.002689042594283819,
      "pose_mae_dtheta": 0.25269123911857605,
      "pose_mae_dx": 0.09278887510299683,
      "pose_mae_dy": 0.02673109993338585,
      "pose_rmse_dtheta": 0.5280681848526001,
      "pose_rmse_dx": 0.24899092316627502,
      "pose_rmse_dy": 0.05246464163064957,
      "pose_rmse_mean": 0.2765079140663147,
      "rmse_dtheta": 0.05024676397442818,
      "rmse_dx": 0.023683719336986542,
      "rmse_dy": 0.00489602517336607,
      "rmse_mean": 0.026275504380464554,
      "rotation_flip": 0.007246376946568489,
      "sparse_tokens": 4425.0,
      "step": 10329,
      "turn_loss": 0.2840113043785095,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.479929381155919,
      "grad_norm": 0.448611319065094,
      "learning_rate": 4.802655521783934e-07,
      "loss": 0.095,
      "mae_dtheta": 0.011961703188717365,
      "mae_dx": 0.0016175294294953346,
      "mae_dy": 0.003025297774001956,
      "pose_mae_dtheta": 0.07423459738492966,
      "pose_mae_dx": 0.02033703587949276,
      "pose_mae_dy": 0.03421172872185707,
      "pose_rmse_dtheta": 0.14623746275901794,
      "pose_rmse_dx": 0.0548957958817482,
      "pose_rmse_dy": 0.07374158501625061,
      "pose_rmse_mean": 0.09162494540214539,
      "rmse_dtheta": 0.022958790883421898,
      "rmse_dx": 0.00468390854075551,
      "rmse_dy": 0.00639417814090848,
      "rmse_mean": 0.011345626786351204,
      "rotation_flip": 0.012948207557201385,
      "sparse_tokens": 32137.0,
      "step": 10330,
      "turn_loss": 0.1142994686961174,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.47997584092176176,
      "grad_norm": 0.3504021167755127,
      "learning_rate": 4.797002701668441e-07,
      "loss": 0.0761,
      "mae_dtheta": 0.01022211741656065,
      "mae_dx": 0.001589596038684249,
      "mae_dy": 0.002500048605725169,
      "pose_mae_dtheta": 0.06646490097045898,
      "pose_mae_dx": 0.019379353150725365,
      "pose_mae_dy": 0.023939961567521095,
      "pose_rmse_dtheta": 0.20047906041145325,
      "pose_rmse_dx": 0.0571834035217762,
      "pose_rmse_dy": 0.05901119485497475,
      "pose_rmse_mean": 0.1055578887462616,
      "rmse_dtheta": 0.023887382820248604,
      "rmse_dx": 0.004192200023680925,
      "rmse_dy": 0.005847774911671877,
      "rmse_mean": 0.011309119872748852,
      "rotation_flip": 0.0047479914501309395,
      "sparse_tokens": 32121.0,
      "step": 10331,
      "turn_loss": 0.08704560250043869,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.48002230068760454,
      "grad_norm": 0.5854711532592773,
      "learning_rate": 4.791353042622815e-07,
      "loss": 0.1664,
      "mae_dtheta": 0.01953449845314026,
      "mae_dx": 0.004253672435879707,
      "mae_dy": 0.004300017841160297,
      "pose_mae_dtheta": 0.1396530568599701,
      "pose_mae_dx": 0.04795409366488457,
      "pose_mae_dy": 0.07676522433757782,
      "pose_rmse_dtheta": 0.24867741763591766,
      "pose_rmse_dx": 0.1243438795208931,
      "pose_rmse_dy": 0.16429169476032257,
      "pose_rmse_mean": 0.17910432815551758,
      "rmse_dtheta": 0.03183601796627045,
      "rmse_dx": 0.013392608612775803,
      "rmse_dy": 0.007521823979914188,
      "rmse_mean": 0.017583483830094337,
      "rotation_flip": 0.01339829433709383,
      "sparse_tokens": 18626.0,
      "step": 10332,
      "turn_loss": 0.15531720221042633,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 29431.0,
      "epoch": 0.4800687604534473,
      "grad_norm": 0.5613039135932922,
      "learning_rate": 4.785706545042141e-07,
      "loss": 0.1501,
      "mae_dtheta": 0.0302688367664814,
      "mae_dx": 0.010840971022844315,
      "mae_dy": 0.004145513288676739,
      "pose_mae_dtheta": 0.2374456822872162,
      "pose_mae_dx": 0.08640087395906448,
      "pose_mae_dy": 0.05660122260451317,
      "pose_rmse_dtheta": 0.4451933801174164,
      "pose_rmse_dx": 0.19177164137363434,
      "pose_rmse_dy": 0.13232341408729553,
      "pose_rmse_mean": 0.2564294934272766,
      "rmse_dtheta": 0.04868107661604881,
      "rmse_dx": 0.023298058658838272,
      "rmse_dy": 0.007405025884509087,
      "rmse_mean": 0.026461388915777206,
      "rotation_flip": 0.012102873995900154,
      "sparse_tokens": 22967.0,
      "step": 10333,
      "turn_loss": 0.22349579632282257,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4801152202192901,
      "grad_norm": 0.31011098623275757,
      "learning_rate": 4.780063209321267e-07,
      "loss": 0.0752,
      "mae_dtheta": 0.013276119716465473,
      "mae_dx": 0.002294182777404785,
      "mae_dy": 0.0035927044227719307,
      "pose_mae_dtheta": 0.08689647912979126,
      "pose_mae_dx": 0.02705223299562931,
      "pose_mae_dy": 0.031617481261491776,
      "pose_rmse_dtheta": 0.2067975550889969,
      "pose_rmse_dx": 0.06222241371870041,
      "pose_rmse_dy": 0.06249004602432251,
      "pose_rmse_mean": 0.11050333827733994,
      "rmse_dtheta": 0.026158008724451065,
      "rmse_dx": 0.007213942240923643,
      "rmse_dy": 0.00842344481498003,
      "rmse_mean": 0.013931798748672009,
      "rotation_flip": 0.0018773466581478715,
      "sparse_tokens": 32105.0,
      "step": 10334,
      "turn_loss": 0.10905861854553223,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.48016167998513287,
      "grad_norm": 0.2637128233909607,
      "learning_rate": 4.774423035854858e-07,
      "loss": 0.0603,
      "mae_dtheta": 0.008224576711654663,
      "mae_dx": 0.0009897594572976232,
      "mae_dy": 0.0019359593279659748,
      "pose_mae_dtheta": 0.053706783801317215,
      "pose_mae_dx": 0.014294574037194252,
      "pose_mae_dy": 0.021804817020893097,
      "pose_rmse_dtheta": 0.13908688724040985,
      "pose_rmse_dx": 0.039083585143089294,
      "pose_rmse_dy": 0.048299457877874374,
      "pose_rmse_mean": 0.07548998296260834,
      "rmse_dtheta": 0.018484553322196007,
      "rmse_dx": 0.0025576790794730186,
      "rmse_dy": 0.004170367028564215,
      "rmse_mean": 0.008404199965298176,
      "rotation_flip": 0.005854800809174776,
      "sparse_tokens": 32089.0,
      "step": 10335,
      "turn_loss": 0.060285720974206924,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.48020813975097565,
      "grad_norm": 0.6734414100646973,
      "learning_rate": 4.768786025037308e-07,
      "loss": 0.1298,
      "mae_dtheta": 0.018991990014910698,
      "mae_dx": 0.004871346987783909,
      "mae_dy": 0.003211747156456113,
      "pose_mae_dtheta": 0.1321178525686264,
      "pose_mae_dx": 0.04753139987587929,
      "pose_mae_dy": 0.0403306744992733,
      "pose_rmse_dtheta": 0.2840343117713928,
      "pose_rmse_dx": 0.128579780459404,
      "pose_rmse_dy": 0.0885205864906311,
      "pose_rmse_mean": 0.16704490780830383,
      "rmse_dtheta": 0.03702404350042343,
      "rmse_dx": 0.01352995727211237,
      "rmse_dy": 0.007219464052468538,
      "rmse_mean": 0.019257821142673492,
      "rotation_flip": 0.009259259328246117,
      "sparse_tokens": 7798.0,
      "step": 10336,
      "turn_loss": 0.1303030401468277,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4802545995168184,
      "grad_norm": 0.4877399206161499,
      "learning_rate": 4.763152177262836e-07,
      "loss": 0.1211,
      "mae_dtheta": 0.009043529629707336,
      "mae_dx": 0.0013572201132774353,
      "mae_dy": 0.002153982874006033,
      "pose_mae_dtheta": 0.06326811015605927,
      "pose_mae_dx": 0.017937852069735527,
      "pose_mae_dy": 0.024999035522341728,
      "pose_rmse_dtheta": 0.1530313640832901,
      "pose_rmse_dx": 0.04656573012471199,
      "pose_rmse_dy": 0.056057531386613846,
      "pose_rmse_mean": 0.08521821349859238,
      "rmse_dtheta": 0.018075941130518913,
      "rmse_dx": 0.004098861012607813,
      "rmse_dy": 0.004503733012825251,
      "rmse_mean": 0.00889284536242485,
      "rotation_flip": 0.004806041717529297,
      "sparse_tokens": 32105.0,
      "step": 10337,
      "turn_loss": 0.06907627731561661,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4803010592826612,
      "grad_norm": 0.4263416528701782,
      "learning_rate": 4.757521492925404e-07,
      "loss": 0.1093,
      "mae_dtheta": 0.007218512706458569,
      "mae_dx": 0.0011432686587795615,
      "mae_dy": 0.0013412580592557788,
      "pose_mae_dtheta": 0.04625875875353813,
      "pose_mae_dx": 0.014726660214364529,
      "pose_mae_dy": 0.018357424065470695,
      "pose_rmse_dtheta": 0.11195756494998932,
      "pose_rmse_dx": 0.03983784094452858,
      "pose_rmse_dy": 0.04529774934053421,
      "pose_rmse_mean": 0.06569772213697433,
      "rmse_dtheta": 0.017177341505885124,
      "rmse_dx": 0.003957335837185383,
      "rmse_dy": 0.0028333687223494053,
      "rmse_mean": 0.007989348843693733,
      "rotation_flip": 0.0023094688076525927,
      "sparse_tokens": 32137.0,
      "step": 10338,
      "turn_loss": 0.05421141907572746,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.480347519048504,
      "grad_norm": 0.5417527556419373,
      "learning_rate": 4.751893972418781e-07,
      "loss": 0.0986,
      "mae_dtheta": 0.02528820000588894,
      "mae_dx": 0.005083998665213585,
      "mae_dy": 0.007544778753072023,
      "pose_mae_dtheta": 0.17751990258693695,
      "pose_mae_dx": 0.033211708068847656,
      "pose_mae_dy": 0.10854663699865341,
      "pose_rmse_dtheta": 0.29883408546447754,
      "pose_rmse_dx": 0.05691025033593178,
      "pose_rmse_dy": 0.19818256795406342,
      "pose_rmse_mean": 0.18464230000972748,
      "rmse_dtheta": 0.03687400370836258,
      "rmse_dx": 0.014273027889430523,
      "rmse_dy": 0.01146283932030201,
      "rmse_mean": 0.020869959145784378,
      "rotation_flip": 0.014778325334191322,
      "sparse_tokens": 3740.0,
      "step": 10339,
      "turn_loss": 0.16552746295928955,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.48039397881434676,
      "grad_norm": 0.36062178015708923,
      "learning_rate": 4.7462696161365006e-07,
      "loss": 0.0645,
      "mae_dtheta": 0.008509769104421139,
      "mae_dx": 0.0017392607405781746,
      "mae_dy": 0.0018501176964491606,
      "pose_mae_dtheta": 0.05627259612083435,
      "pose_mae_dx": 0.01780630648136139,
      "pose_mae_dy": 0.020033450797200203,
      "pose_rmse_dtheta": 0.15417586266994476,
      "pose_rmse_dx": 0.04126608371734619,
      "pose_rmse_dy": 0.054071780294179916,
      "pose_rmse_mean": 0.08317124843597412,
      "rmse_dtheta": 0.021632879972457886,
      "rmse_dx": 0.004560421220958233,
      "rmse_dy": 0.005523155443370342,
      "rmse_mean": 0.010572153143584728,
      "rotation_flip": 0.004894578363746405,
      "sparse_tokens": 32233.0,
      "step": 10340,
      "turn_loss": 0.06735927611589432,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.48044043858018953,
      "grad_norm": 0.5311205983161926,
      "learning_rate": 4.740648424471872e-07,
      "loss": 0.0938,
      "mae_dtheta": 0.0070793903432786465,
      "mae_dx": 0.0012193901930004358,
      "mae_dy": 0.0015204634983092546,
      "pose_mae_dtheta": 0.04581885784864426,
      "pose_mae_dx": 0.016478518024086952,
      "pose_mae_dy": 0.01821155846118927,
      "pose_rmse_dtheta": 0.12824252247810364,
      "pose_rmse_dx": 0.05965498462319374,
      "pose_rmse_dy": 0.049896951764822006,
      "pose_rmse_mean": 0.0792648196220398,
      "rmse_dtheta": 0.018430491909384727,
      "rmse_dx": 0.0036416922230273485,
      "rmse_dy": 0.0044846562668681145,
      "rmse_mean": 0.008852280676364899,
      "rotation_flip": 0.0060747661627829075,
      "sparse_tokens": 32105.0,
      "step": 10341,
      "turn_loss": 0.060530826449394226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.4804868983460323,
      "grad_norm": 0.5359205603599548,
      "learning_rate": 4.7350303978179967e-07,
      "loss": 0.1317,
      "mae_dtheta": 0.031869761645793915,
      "mae_dx": 0.013829179108142853,
      "mae_dy": 0.0054632676765322685,
      "pose_mae_dtheta": 0.23180066049098969,
      "pose_mae_dx": 0.09994503110647202,
      "pose_mae_dy": 0.06700345128774643,
      "pose_rmse_dtheta": 0.36780786514282227,
      "pose_rmse_dx": 0.21735605597496033,
      "pose_rmse_dy": 0.15027925372123718,
      "pose_rmse_mean": 0.24514774978160858,
      "rmse_dtheta": 0.047585878521203995,
      "rmse_dx": 0.02655448578298092,
      "rmse_dy": 0.011071297340095043,
      "rmse_mean": 0.028403885662555695,
      "rotation_flip": 0.01552795059978962,
      "sparse_tokens": 10483.0,
      "step": 10342,
      "turn_loss": 0.27327805757522583,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.48053335811187514,
      "grad_norm": 0.6776525974273682,
      "learning_rate": 4.7294155365677386e-07,
      "loss": 0.144,
      "mae_dtheta": 0.027372661978006363,
      "mae_dx": 0.011325214058160782,
      "mae_dy": 0.0067145368084311485,
      "pose_mae_dtheta": 0.20402587950229645,
      "pose_mae_dx": 0.10467593371868134,
      "pose_mae_dy": 0.08597782999277115,
      "pose_rmse_dtheta": 0.3597736954689026,
      "pose_rmse_dx": 0.21783623099327087,
      "pose_rmse_dy": 0.1831471025943756,
      "pose_rmse_mean": 0.25358566641807556,
      "rmse_dtheta": 0.04552406817674637,
      "rmse_dx": 0.02318784035742283,
      "rmse_dy": 0.013278181664645672,
      "rmse_mean": 0.027330029755830765,
      "rotation_flip": 0.015665795654058456,
      "sparse_tokens": 13945.0,
      "step": 10343,
      "turn_loss": 0.2565849721431732,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.4805798178777179,
      "grad_norm": 0.7893688082695007,
      "learning_rate": 4.72380384111375e-07,
      "loss": 0.1477,
      "mae_dtheta": 0.03793894872069359,
      "mae_dx": 0.008783417753875256,
      "mae_dy": 0.002337157027795911,
      "pose_mae_dtheta": 0.323493093252182,
      "pose_mae_dx": 0.06482592970132828,
      "pose_mae_dy": 0.027086155489087105,
      "pose_rmse_dtheta": 0.5948455333709717,
      "pose_rmse_dx": 0.14522215723991394,
      "pose_rmse_dy": 0.07652917504310608,
      "pose_rmse_mean": 0.27219897508621216,
      "rmse_dtheta": 0.05936986953020096,
      "rmse_dx": 0.018310582265257835,
      "rmse_dy": 0.00560003612190485,
      "rmse_mean": 0.027760162949562073,
      "rotation_flip": 0.021008403971791267,
      "sparse_tokens": 7374.0,
      "step": 10344,
      "turn_loss": 0.2264363020658493,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.4806262776435607,
      "grad_norm": 0.6943341493606567,
      "learning_rate": 4.7181953118484556e-07,
      "loss": 0.1751,
      "mae_dtheta": 0.029625417664647102,
      "mae_dx": 0.010971296578645706,
      "mae_dy": 0.004910638090223074,
      "pose_mae_dtheta": 0.2140539437532425,
      "pose_mae_dx": 0.077521413564682,
      "pose_mae_dy": 0.0554555281996727,
      "pose_rmse_dtheta": 0.38645344972610474,
      "pose_rmse_dx": 0.16009333729743958,
      "pose_rmse_dy": 0.12011168152093887,
      "pose_rmse_mean": 0.22221951186656952,
      "rmse_dtheta": 0.04570477828383446,
      "rmse_dx": 0.022214854136109352,
      "rmse_dy": 0.00859268382191658,
      "rmse_mean": 0.025504108518362045,
      "rotation_flip": 0.010441767051815987,
      "sparse_tokens": 20095.0,
      "step": 10345,
      "turn_loss": 0.2462545782327652,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 25311.0,
      "epoch": 0.48067273740940347,
      "grad_norm": 0.6082069277763367,
      "learning_rate": 4.712589949164076e-07,
      "loss": 0.1571,
      "mae_dtheta": 0.030303366482257843,
      "mae_dx": 0.010476534254848957,
      "mae_dy": 0.005727291107177734,
      "pose_mae_dtheta": 0.2172076553106308,
      "pose_mae_dx": 0.07666079699993134,
      "pose_mae_dy": 0.05107869580388069,
      "pose_rmse_dtheta": 0.3974555730819702,
      "pose_rmse_dx": 0.1796368658542633,
      "pose_rmse_dy": 0.1267726868391037,
      "pose_rmse_mean": 0.23462170362472534,
      "rmse_dtheta": 0.0482744500041008,
      "rmse_dx": 0.021951578557491302,
      "rmse_dy": 0.012822560966014862,
      "rmse_mean": 0.027682863175868988,
      "rotation_flip": 0.008291874080896378,
      "sparse_tokens": 19949.0,
      "step": 10346,
      "turn_loss": 0.24447940289974213,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.48071919717524625,
      "grad_norm": 0.7274050712585449,
      "learning_rate": 4.706987753452591e-07,
      "loss": 0.1428,
      "mae_dtheta": 0.048108186572790146,
      "mae_dx": 0.010895739309489727,
      "mae_dy": 0.0031967696268111467,
      "pose_mae_dtheta": 0.3921845555305481,
      "pose_mae_dx": 0.10086898505687714,
      "pose_mae_dy": 0.04914942756295204,
      "pose_rmse_dtheta": 0.6016570925712585,
      "pose_rmse_dx": 0.21684008836746216,
      "pose_rmse_dy": 0.1040460467338562,
      "pose_rmse_mean": 0.3075144290924072,
      "rmse_dtheta": 0.0649389997124672,
      "rmse_dx": 0.022537712007761,
      "rmse_dy": 0.005859535653144121,
      "rmse_mean": 0.03111208602786064,
      "rotation_flip": 0.016949152573943138,
      "sparse_tokens": 7548.0,
      "step": 10347,
      "turn_loss": 0.22635363042354584,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.480765656941089,
      "grad_norm": 0.42804357409477234,
      "learning_rate": 4.701388725105749e-07,
      "loss": 0.1132,
      "mae_dtheta": 0.008461440913379192,
      "mae_dx": 0.0020842452067881823,
      "mae_dy": 0.0026850802823901176,
      "pose_mae_dtheta": 0.05471404641866684,
      "pose_mae_dx": 0.026098841801285744,
      "pose_mae_dy": 0.023514019325375557,
      "pose_rmse_dtheta": 0.15206843614578247,
      "pose_rmse_dx": 0.0676799863576889,
      "pose_rmse_dy": 0.053438544273376465,
      "pose_rmse_mean": 0.09106232970952988,
      "rmse_dtheta": 0.019840821623802185,
      "rmse_dx": 0.005330576561391354,
      "rmse_dy": 0.006715803407132626,
      "rmse_mean": 0.01062906812876463,
      "rotation_flip": 0.004795278422534466,
      "sparse_tokens": 32153.0,
      "step": 10348,
      "turn_loss": 0.0788579210639,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36227.0,
      "epoch": 0.4808121167069318,
      "grad_norm": 0.6694808006286621,
      "learning_rate": 4.69579286451512e-07,
      "loss": 0.1885,
      "mae_dtheta": 0.03677499294281006,
      "mae_dx": 0.017134031280875206,
      "mae_dy": 0.0049242889508605,
      "pose_mae_dtheta": 0.3302502930164337,
      "pose_mae_dx": 0.15675228834152222,
      "pose_mae_dy": 0.07655378431081772,
      "pose_rmse_dtheta": 0.5411025881767273,
      "pose_rmse_dx": 0.32039955258369446,
      "pose_rmse_dy": 0.17271046340465546,
      "pose_rmse_mean": 0.34473752975463867,
      "rmse_dtheta": 0.053371280431747437,
      "rmse_dx": 0.03131382539868355,
      "rmse_dy": 0.00989701971411705,
      "rmse_mean": 0.03152737766504288,
      "rotation_flip": 0.011067708022892475,
      "sparse_tokens": 24062.0,
      "step": 10349,
      "turn_loss": 0.2952083647251129,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4808585764727746,
      "grad_norm": 0.30821433663368225,
      "learning_rate": 4.6902001720720015e-07,
      "loss": 0.0745,
      "mae_dtheta": 0.009732742793858051,
      "mae_dx": 0.0015403395518660545,
      "mae_dy": 0.002724928315728903,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.30821430683135986,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.3334503173828,
      "model/head/act_norm_mean": 106.64173966224747,
      "model/head/act_norm_min": 53.56736373901367,
      "model/head/act_over_embed": 73.28520189159316,
      "model/head/grad_frac": 0.10904818028211594,
      "model/head/grad_norm": 0.033610209822654724,
      "model/head/grad_zero_frac": 0.00020781300554517657,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7059511126893939,
      "model/head/update_ratio": 0.0005721680936403573,
      "model/head/weight_delta": 9.96485424041748,
      "model/head/weight_delta_rel": 0.17481306195259094,
      "model/head/weight_norm": 58.74184799194336,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42287012934684753,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227895009678041,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42271900177001953,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905449032827458,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09018101543188095,
      "model/modality_embedder.encoders.pose/grad_norm": 0.027795078232884407,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5158264433856502,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0008974880329333246,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1517763137817383,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10297835618257523,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969860076904297,
      "model/modality_embedder/grad_frac": 0.09018101543188095,
      "model/modality_embedder/grad_norm": 0.027795078232884407,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5158264433856502,
      "model/modality_embedder/update_ratio": 0.0008974880329333246,
      "model/modality_embedder/weight_delta": 3.1517763137817383,
      "model/modality_embedder/weight_delta_rel": 0.10297835618257523,
      "model/modality_embedder/weight_norm": 30.969860076904297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.60962677001953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.316425665384,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.03062629699707,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.02326600906821,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0597025491297245,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.01840117946267128,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0006581548368558288,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7312726974487305,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0995292216539383,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.958740234375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.28547668457031,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.283592372134038,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.389676094055176,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.687912024704204,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06620269268751144,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.020404616370797157,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0006854807143099606,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4630143642425537,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11996152251958847,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.766870498657227,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.15838623046875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.13181417348084,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.463313102722168,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.958027349914847,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06870681792497635,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.021176423877477646,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0006889291107654572,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7511632442474365,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12595704197883606,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.738176345825195,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.8542709350586,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.876380371172036,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.311485290527344,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.15690957385431,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07180311530828476,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.022130746394395828,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007388718659058213,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.223356246948242,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1101590171456337,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.952075958251953,
      "model/normalizer/grad_frac": 0.2705264687538147,
      "model/normalizer/grad_norm": 0.08338012546300888,
      "model/normalizer/grad_zero_frac": 0.0002079859550576657,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010600944515317678,
      "model/normalizer/weight_delta": 6.780909538269043,
      "model/normalizer/weight_delta_rel": 0.08733418583869934,
      "model/normalizer/weight_norm": 78.65348815917969,
      "pose_mae_dtheta": 0.06549055129289627,
      "pose_mae_dx": 0.021713774651288986,
      "pose_mae_dy": 0.027962373569607735,
      "pose_rmse_dtheta": 0.1759834736585617,
      "pose_rmse_dx": 0.05278575420379639,
      "pose_rmse_dy": 0.058590300381183624,
      "pose_rmse_mean": 0.09578651189804077,
      "rmse_dtheta": 0.021465541794896126,
      "rmse_dx": 0.004325712565332651,
      "rmse_dy": 0.006063785403966904,
      "rmse_mean": 0.010618346743285656,
      "rotation_flip": 0.006099885795265436,
      "sparse_tokens": 32105.0,
      "step": 10350,
      "turn_loss": 0.09236246347427368,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.48090503623861736,
      "grad_norm": 0.46894606947898865,
      "learning_rate": 4.6846106481675035e-07,
      "loss": 0.0832,
      "mae_dtheta": 0.00961944367736578,
      "mae_dx": 0.0012217473704367876,
      "mae_dy": 0.0021358649246394634,
      "pose_mae_dtheta": 0.0627269372344017,
      "pose_mae_dx": 0.01866202801465988,
      "pose_mae_dy": 0.02629658952355385,
      "pose_rmse_dtheta": 0.1718166172504425,
      "pose_rmse_dx": 0.04309587553143501,
      "pose_rmse_dy": 0.05682395398616791,
      "pose_rmse_mean": 0.09057881683111191,
      "rmse_dtheta": 0.020940758287906647,
      "rmse_dx": 0.0032321233302354813,
      "rmse_dy": 0.004442609380930662,
      "rmse_mean": 0.009538497775793076,
      "rotation_flip": 0.0031213422771543264,
      "sparse_tokens": 32105.0,
      "step": 10351,
      "turn_loss": 0.06999611854553223,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.48095149600446013,
      "grad_norm": 0.43254074454307556,
      "learning_rate": 4.6790242931925135e-07,
      "loss": 0.1398,
      "mae_dtheta": 0.03342723846435547,
      "mae_dx": 0.01261588279157877,
      "mae_dy": 0.00451556546613574,
      "pose_mae_dtheta": 0.24854156374931335,
      "pose_mae_dx": 0.11032898724079132,
      "pose_mae_dy": 0.06352029740810394,
      "pose_rmse_dtheta": 0.4380964934825897,
      "pose_rmse_dx": 0.24988259375095367,
      "pose_rmse_dy": 0.13301846385002136,
      "pose_rmse_mean": 0.2736658751964569,
      "rmse_dtheta": 0.050430700182914734,
      "rmse_dx": 0.02567470818758011,
      "rmse_dy": 0.008101296611130238,
      "rmse_mean": 0.0280689038336277,
      "rotation_flip": 0.015329125337302685,
      "sparse_tokens": 20432.0,
      "step": 10352,
      "turn_loss": 0.22960461676120758,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.4809979557703029,
      "grad_norm": 0.6594364047050476,
      "learning_rate": 4.673441107537674e-07,
      "loss": 0.1561,
      "mae_dtheta": 0.0225022342056036,
      "mae_dx": 0.010070118121802807,
      "mae_dy": 0.007175767794251442,
      "pose_mae_dtheta": 0.15619224309921265,
      "pose_mae_dx": 0.08831825852394104,
      "pose_mae_dy": 0.08252233266830444,
      "pose_rmse_dtheta": 0.2867262065410614,
      "pose_rmse_dx": 0.21688029170036316,
      "pose_rmse_dy": 0.18520048260688782,
      "pose_rmse_mean": 0.22960233688354492,
      "rmse_dtheta": 0.03575390577316284,
      "rmse_dx": 0.02259027399122715,
      "rmse_dy": 0.01338502299040556,
      "rmse_mean": 0.023909732699394226,
      "rotation_flip": 0.00764818349853158,
      "sparse_tokens": 10640.0,
      "step": 10353,
      "turn_loss": 0.2417958378791809,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.4810444155361457,
      "grad_norm": 0.5032804012298584,
      "learning_rate": 4.667861091593434e-07,
      "loss": 0.096,
      "mae_dtheta": 0.041336141526699066,
      "mae_dx": 0.00998296495527029,
      "mae_dy": 0.004061421379446983,
      "pose_mae_dtheta": 0.3559912443161011,
      "pose_mae_dx": 0.06158919259905815,
      "pose_mae_dy": 0.05730576068162918,
      "pose_rmse_dtheta": 0.6813858151435852,
      "pose_rmse_dx": 0.15972284972667694,
      "pose_rmse_dy": 0.15869435667991638,
      "pose_rmse_mean": 0.3332676887512207,
      "rmse_dtheta": 0.0660429447889328,
      "rmse_dx": 0.022898880764842033,
      "rmse_dy": 0.008409923873841763,
      "rmse_mean": 0.032450586557388306,
      "rotation_flip": 0.004842615220695734,
      "sparse_tokens": 7928.0,
      "step": 10354,
      "turn_loss": 0.21356159448623657,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 29522.0,
      "epoch": 0.48109087530198846,
      "grad_norm": 1.4381835460662842,
      "learning_rate": 4.6622842457499875e-07,
      "loss": 0.2909,
      "mae_dtheta": 0.023690547794103622,
      "mae_dx": 0.008424931205809116,
      "mae_dy": 0.005136596970260143,
      "pose_mae_dtheta": 0.1787264496088028,
      "pose_mae_dx": 0.06517870724201202,
      "pose_mae_dy": 0.05833236873149872,
      "pose_rmse_dtheta": 0.39208269119262695,
      "pose_rmse_dx": 0.1858702152967453,
      "pose_rmse_dy": 0.1707213819026947,
      "pose_rmse_mean": 0.24955809116363525,
      "rmse_dtheta": 0.04509688913822174,
      "rmse_dx": 0.020413735881447792,
      "rmse_dy": 0.014271912164986134,
      "rmse_mean": 0.02659418061375618,
      "rotation_flip": 0.002197802299633622,
      "sparse_tokens": 22368.0,
      "step": 10355,
      "turn_loss": 0.2776200473308563,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.48113733506783124,
      "grad_norm": 0.3919064402580261,
      "learning_rate": 4.6567105703973493e-07,
      "loss": 0.0612,
      "mae_dtheta": 0.009249106980860233,
      "mae_dx": 0.001786442007869482,
      "mae_dy": 0.002302036853507161,
      "pose_mae_dtheta": 0.06293060630559921,
      "pose_mae_dx": 0.01981962099671364,
      "pose_mae_dy": 0.025013089179992676,
      "pose_rmse_dtheta": 0.16517284512519836,
      "pose_rmse_dx": 0.04536445811390877,
      "pose_rmse_dy": 0.062401674687862396,
      "pose_rmse_mean": 0.09097965806722641,
      "rmse_dtheta": 0.020529665052890778,
      "rmse_dx": 0.0052276793867349625,
      "rmse_dy": 0.006650138646364212,
      "rmse_mean": 0.010802495293319225,
      "rotation_flip": 0.006007066927850246,
      "sparse_tokens": 32169.0,
      "step": 10356,
      "turn_loss": 0.08461978286504745,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36338.0,
      "epoch": 0.481183794833674,
      "grad_norm": 0.5165175795555115,
      "learning_rate": 4.651140065925269e-07,
      "loss": 0.1282,
      "mae_dtheta": 0.03614721819758415,
      "mae_dx": 0.00949972402304411,
      "mae_dy": 0.006395986769348383,
      "pose_mae_dtheta": 0.27991220355033875,
      "pose_mae_dx": 0.07962742447853088,
      "pose_mae_dy": 0.0638091191649437,
      "pose_rmse_dtheta": 0.4811982214450836,
      "pose_rmse_dx": 0.1740104854106903,
      "pose_rmse_dy": 0.1525811105966568,
      "pose_rmse_mean": 0.26926326751708984,
      "rmse_dtheta": 0.05422280728816986,
      "rmse_dx": 0.020382152870297432,
      "rmse_dy": 0.013616538606584072,
      "rmse_mean": 0.029407165944576263,
      "rotation_flip": 0.01631046086549759,
      "sparse_tokens": 27604.0,
      "step": 10357,
      "turn_loss": 0.3250596821308136,
      "turns": 112.0,
      "turns_per_sample": 112.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4812302545995168,
      "grad_norm": 0.6024094820022583,
      "learning_rate": 4.6455727327233023e-07,
      "loss": 0.1491,
      "mae_dtheta": 0.005988260731101036,
      "mae_dx": 0.001316150650382042,
      "mae_dy": 0.0006806082674302161,
      "pose_mae_dtheta": 0.04240359365940094,
      "pose_mae_dx": 0.01127652358263731,
      "pose_mae_dy": 0.008861878886818886,
      "pose_rmse_dtheta": 0.14501366019248962,
      "pose_rmse_dx": 0.0321628674864769,
      "pose_rmse_dy": 0.02493058145046234,
      "pose_rmse_mean": 0.06736904382705688,
      "rmse_dtheta": 0.019581343978643417,
      "rmse_dx": 0.003949121572077274,
      "rmse_dy": 0.0018626624951139092,
      "rmse_mean": 0.008464375510811806,
      "rotation_flip": 0.0015535991406068206,
      "sparse_tokens": 32185.0,
      "step": 10358,
      "turn_loss": 0.04550716280937195,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.4812767143653596,
      "grad_norm": 0.47576937079429626,
      "learning_rate": 4.640008571180793e-07,
      "loss": 0.0821,
      "mae_dtheta": 0.03493838757276535,
      "mae_dx": 0.010794857516884804,
      "mae_dy": 0.005477244034409523,
      "pose_mae_dtheta": 0.27728214859962463,
      "pose_mae_dx": 0.08443424105644226,
      "pose_mae_dy": 0.052887823432683945,
      "pose_rmse_dtheta": 0.48901447653770447,
      "pose_rmse_dx": 0.1975969523191452,
      "pose_rmse_dy": 0.11401737481355667,
      "pose_rmse_mean": 0.2668762803077698,
      "rmse_dtheta": 0.054090023040771484,
      "rmse_dx": 0.023057715967297554,
      "rmse_dy": 0.011518551968038082,
      "rmse_mean": 0.0295554306358099,
      "rotation_flip": 0.010434783063828945,
      "sparse_tokens": 12255.0,
      "step": 10359,
      "turn_loss": 0.2924747169017792,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4813231741312024,
      "grad_norm": 0.5367660522460938,
      "learning_rate": 4.634447581686813e-07,
      "loss": 0.1234,
      "mae_dtheta": 0.00819867942482233,
      "mae_dx": 0.00144187081605196,
      "mae_dy": 0.001824420178309083,
      "pose_mae_dtheta": 0.054375987499952316,
      "pose_mae_dx": 0.014583761803805828,
      "pose_mae_dy": 0.017162466421723366,
      "pose_rmse_dtheta": 0.15971723198890686,
      "pose_rmse_dx": 0.03691929951310158,
      "pose_rmse_dy": 0.039938222616910934,
      "pose_rmse_mean": 0.07885825634002686,
      "rmse_dtheta": 0.021139467135071754,
      "rmse_dx": 0.004182007163763046,
      "rmse_dy": 0.005013713613152504,
      "rmse_mean": 0.010111729614436626,
      "rotation_flip": 0.006650041788816452,
      "sparse_tokens": 32137.0,
      "step": 10360,
      "turn_loss": 0.06890840083360672,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4813696338970452,
      "grad_norm": 0.6196430921554565,
      "learning_rate": 4.628889764630279e-07,
      "loss": 0.1579,
      "mae_dtheta": 0.006858042906969786,
      "mae_dx": 0.001209300011396408,
      "mae_dy": 0.0013390413951128721,
      "pose_mae_dtheta": 0.04792343080043793,
      "pose_mae_dx": 0.01166989840567112,
      "pose_mae_dy": 0.017730439081788063,
      "pose_rmse_dtheta": 0.1536681354045868,
      "pose_rmse_dx": 0.03600252419710159,
      "pose_rmse_dy": 0.06082657724618912,
      "pose_rmse_mean": 0.08349907398223877,
      "rmse_dtheta": 0.019435640424489975,
      "rmse_dx": 0.004564906004816294,
      "rmse_dy": 0.004101092461496592,
      "rmse_mean": 0.009367212653160095,
      "rotation_flip": 0.0006349206087179482,
      "sparse_tokens": 32073.0,
      "step": 10361,
      "turn_loss": 0.05672918260097504,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.48141609366288796,
      "grad_norm": 0.5316708087921143,
      "learning_rate": 4.623335120399819e-07,
      "loss": 0.1214,
      "mae_dtheta": 0.03049883246421814,
      "mae_dx": 0.009077091701328754,
      "mae_dy": 0.005550814792513847,
      "pose_mae_dtheta": 0.21459613740444183,
      "pose_mae_dx": 0.08939539641141891,
      "pose_mae_dy": 0.06234954670071602,
      "pose_rmse_dtheta": 0.3528912663459778,
      "pose_rmse_dx": 0.19515211880207062,
      "pose_rmse_dy": 0.13411003351211548,
      "pose_rmse_mean": 0.22738447785377502,
      "rmse_dtheta": 0.04548723250627518,
      "rmse_dx": 0.019841302186250687,
      "rmse_dy": 0.00969705916941166,
      "rmse_mean": 0.025008533149957657,
      "rotation_flip": 0.01662510447204113,
      "sparse_tokens": 18527.0,
      "step": 10362,
      "turn_loss": 0.26693758368492126,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.48146255342873073,
      "grad_norm": 0.5992936491966248,
      "learning_rate": 4.617783649383906e-07,
      "loss": 0.1856,
      "mae_dtheta": 0.03857719525694847,
      "mae_dx": 0.007231831084936857,
      "mae_dy": 0.005774254444986582,
      "pose_mae_dtheta": 0.2972363233566284,
      "pose_mae_dx": 0.06410878896713257,
      "pose_mae_dy": 0.04806474223732948,
      "pose_rmse_dtheta": 0.5524106025695801,
      "pose_rmse_dx": 0.16665557026863098,
      "pose_rmse_dy": 0.11191346496343613,
      "pose_rmse_mean": 0.2769932150840759,
      "rmse_dtheta": 0.06114955246448517,
      "rmse_dx": 0.016308369114995003,
      "rmse_dy": 0.012534829787909985,
      "rmse_mean": 0.029997583478689194,
      "rotation_flip": 0.006458557676523924,
      "sparse_tokens": 14759.0,
      "step": 10363,
      "turn_loss": 0.27363714575767517,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 19096.0,
      "epoch": 0.4815090131945735,
      "grad_norm": 0.46164584159851074,
      "learning_rate": 4.6122353519707286e-07,
      "loss": 0.0999,
      "mae_dtheta": 0.032066211104393005,
      "mae_dx": 0.009949659928679466,
      "mae_dy": 0.004970239009708166,
      "pose_mae_dtheta": 0.23213955760002136,
      "pose_mae_dx": 0.08291006833314896,
      "pose_mae_dy": 0.05961377173662186,
      "pose_rmse_dtheta": 0.43394696712493896,
      "pose_rmse_dx": 0.2030465006828308,
      "pose_rmse_dy": 0.1154547855257988,
      "pose_rmse_mean": 0.25081610679626465,
      "rmse_dtheta": 0.05052869766950607,
      "rmse_dx": 0.02274961955845356,
      "rmse_dy": 0.009810318239033222,
      "rmse_mean": 0.027696212753653526,
      "rotation_flip": 0.0217627864331007,
      "sparse_tokens": 15629.0,
      "step": 10364,
      "turn_loss": 0.2183048129081726,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4815554729604163,
      "grad_norm": 0.4112239480018616,
      "learning_rate": 4.606690228548294e-07,
      "loss": 0.0988,
      "mae_dtheta": 0.013494190759956837,
      "mae_dx": 0.0025610248558223248,
      "mae_dy": 0.003549790009856224,
      "pose_mae_dtheta": 0.10074525326490402,
      "pose_mae_dx": 0.02833014912903309,
      "pose_mae_dy": 0.031482014805078506,
      "pose_rmse_dtheta": 0.2621218264102936,
      "pose_rmse_dx": 0.07289806753396988,
      "pose_rmse_dy": 0.08052758127450943,
      "pose_rmse_mean": 0.13851583003997803,
      "rmse_dtheta": 0.030890457332134247,
      "rmse_dx": 0.007440507877618074,
      "rmse_dy": 0.008975192904472351,
      "rmse_mean": 0.01576871983706951,
      "rotation_flip": 0.00465890159830451,
      "sparse_tokens": 32137.0,
      "step": 10365,
      "turn_loss": 0.12352076172828674,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.48160193272625906,
      "grad_norm": 0.4499887526035309,
      "learning_rate": 4.601148279504386e-07,
      "loss": 0.0987,
      "mae_dtheta": 0.00921743642538786,
      "mae_dx": 0.0016168456058949232,
      "mae_dy": 0.0024212640710175037,
      "pose_mae_dtheta": 0.061426326632499695,
      "pose_mae_dx": 0.02597096562385559,
      "pose_mae_dy": 0.031497444957494736,
      "pose_rmse_dtheta": 0.13622798025608063,
      "pose_rmse_dx": 0.06756991147994995,
      "pose_rmse_dy": 0.07877247780561447,
      "pose_rmse_mean": 0.09419012069702148,
      "rmse_dtheta": 0.019242340698838234,
      "rmse_dx": 0.0045963008888065815,
      "rmse_dy": 0.005325660575181246,
      "rmse_mean": 0.009721433743834496,
      "rotation_flip": 0.003990422934293747,
      "sparse_tokens": 32105.0,
      "step": 10366,
      "turn_loss": 0.07727552950382233,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.48164839249210184,
      "grad_norm": 0.3213498890399933,
      "learning_rate": 4.595609505226534e-07,
      "loss": 0.0642,
      "mae_dtheta": 0.006565409246832132,
      "mae_dx": 0.0009285875712521374,
      "mae_dy": 0.0013366085477173328,
      "pose_mae_dtheta": 0.03918445482850075,
      "pose_mae_dx": 0.012344601564109325,
      "pose_mae_dy": 0.01634761318564415,
      "pose_rmse_dtheta": 0.1034456267952919,
      "pose_rmse_dx": 0.030468473210930824,
      "pose_rmse_dy": 0.03528838977217674,
      "pose_rmse_mean": 0.056400831788778305,
      "rmse_dtheta": 0.01645057648420334,
      "rmse_dx": 0.002694105263799429,
      "rmse_dy": 0.0027838791720569134,
      "rmse_mean": 0.0073095206171274185,
      "rotation_flip": 0.0014069644967094064,
      "sparse_tokens": 32137.0,
      "step": 10367,
      "turn_loss": 0.04833729937672615,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11379.0,
      "epoch": 0.4816948522579446,
      "grad_norm": 0.5434613227844238,
      "learning_rate": 4.590073906102088e-07,
      "loss": 0.1028,
      "mae_dtheta": 0.030829329043626785,
      "mae_dx": 0.006314905826002359,
      "mae_dy": 0.004141795914620161,
      "pose_mae_dtheta": 0.20338059961795807,
      "pose_mae_dx": 0.047100771218538284,
      "pose_mae_dy": 0.051309868693351746,
      "pose_rmse_dtheta": 0.4152514636516571,
      "pose_rmse_dx": 0.11550384014844894,
      "pose_rmse_dy": 0.12013579905033112,
      "pose_rmse_mean": 0.21696369349956512,
      "rmse_dtheta": 0.04947000741958618,
      "rmse_dx": 0.015551485121250153,
      "rmse_dy": 0.007207592483609915,
      "rmse_mean": 0.024076363071799278,
      "rotation_flip": 0.010582010261714458,
      "sparse_tokens": 8673.0,
      "step": 10368,
      "turn_loss": 0.26326629519462585,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4817413120237874,
      "grad_norm": 0.37174180150032043,
      "learning_rate": 4.58454148251814e-07,
      "loss": 0.0802,
      "mae_dtheta": 0.01146009936928749,
      "mae_dx": 0.0033569487277418375,
      "mae_dy": 0.004384082742035389,
      "pose_mae_dtheta": 0.08286627382040024,
      "pose_mae_dx": 0.03468696400523186,
      "pose_mae_dy": 0.03532572463154793,
      "pose_rmse_dtheta": 0.2168111652135849,
      "pose_rmse_dx": 0.11589283496141434,
      "pose_rmse_dy": 0.10607206076383591,
      "pose_rmse_mean": 0.14625869691371918,
      "rmse_dtheta": 0.025385744869709015,
      "rmse_dx": 0.011165504343807697,
      "rmse_dy": 0.013036143034696579,
      "rmse_mean": 0.016529131680727005,
      "rotation_flip": 0.0039611090905964375,
      "sparse_tokens": 32137.0,
      "step": 10369,
      "turn_loss": 0.12424527108669281,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.48178777178963017,
      "grad_norm": 0.4028635025024414,
      "learning_rate": 4.579012234861585e-07,
      "loss": 0.0946,
      "mae_dtheta": 0.010031681507825851,
      "mae_dx": 0.0013016040902584791,
      "mae_dy": 0.0026505179703235626,
      "pose_mae_dtheta": 0.06620417535305023,
      "pose_mae_dx": 0.020695742219686508,
      "pose_mae_dy": 0.03057078644633293,
      "pose_rmse_dtheta": 0.15086671710014343,
      "pose_rmse_dx": 0.05589842423796654,
      "pose_rmse_dy": 0.07665684819221497,
      "pose_rmse_mean": 0.09447400271892548,
      "rmse_dtheta": 0.021214503794908524,
      "rmse_dx": 0.003701051464304328,
      "rmse_dy": 0.005560243967920542,
      "rmse_mean": 0.0101586002856493,
      "rotation_flip": 0.004369992762804031,
      "sparse_tokens": 32073.0,
      "step": 10370,
      "turn_loss": 0.07936828583478928,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.48183423155547295,
      "grad_norm": 0.4516165256500244,
      "learning_rate": 4.5734861635190864e-07,
      "loss": 0.119,
      "mae_dtheta": 0.007762885186821222,
      "mae_dx": 0.0014297680463641882,
      "mae_dy": 0.0019508887780830264,
      "pose_mae_dtheta": 0.04563549533486366,
      "pose_mae_dx": 0.016410909593105316,
      "pose_mae_dy": 0.020037805661559105,
      "pose_rmse_dtheta": 0.10352378338575363,
      "pose_rmse_dx": 0.040984176099300385,
      "pose_rmse_dy": 0.041316088289022446,
      "pose_rmse_mean": 0.06194135174155235,
      "rmse_dtheta": 0.015861747786402702,
      "rmse_dx": 0.0045797270722687244,
      "rmse_dy": 0.003979946952313185,
      "rmse_mean": 0.008140474557876587,
      "rotation_flip": 0.005831903778016567,
      "sparse_tokens": 32153.0,
      "step": 10371,
      "turn_loss": 0.07495440542697906,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.4818806913213157,
      "grad_norm": 0.35016608238220215,
      "learning_rate": 4.567963268877079e-07,
      "loss": 0.0878,
      "mae_dtheta": 0.033929795026779175,
      "mae_dx": 0.015459212474524975,
      "mae_dy": 0.004471682012081146,
      "pose_mae_dtheta": 0.2572731673717499,
      "pose_mae_dx": 0.11779210716485977,
      "pose_mae_dy": 0.06262814998626709,
      "pose_rmse_dtheta": 0.46547064185142517,
      "pose_rmse_dx": 0.2737767696380615,
      "pose_rmse_dy": 0.15786051750183105,
      "pose_rmse_mean": 0.2990359961986542,
      "rmse_dtheta": 0.0521979033946991,
      "rmse_dx": 0.029906708747148514,
      "rmse_dy": 0.009051354601979256,
      "rmse_mean": 0.030385321006178856,
      "rotation_flip": 0.012332990765571594,
      "sparse_tokens": 16075.0,
      "step": 10372,
      "turn_loss": 0.24020346999168396,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.4819271510871585,
      "grad_norm": 0.45958325266838074,
      "learning_rate": 4.562443551321788e-07,
      "loss": 0.128,
      "mae_dtheta": 0.02882644720375538,
      "mae_dx": 0.013390890322625637,
      "mae_dy": 0.007944251410663128,
      "pose_mae_dtheta": 0.2349821925163269,
      "pose_mae_dx": 0.10532162338495255,
      "pose_mae_dy": 0.10284917056560516,
      "pose_rmse_dtheta": 0.37318137288093567,
      "pose_rmse_dx": 0.23096252977848053,
      "pose_rmse_dy": 0.21459582448005676,
      "pose_rmse_mean": 0.27291327714920044,
      "rmse_dtheta": 0.04220527037978172,
      "rmse_dx": 0.02662711590528488,
      "rmse_dy": 0.013569563627243042,
      "rmse_mean": 0.027467316016554832,
      "rotation_flip": 0.013461538590490818,
      "sparse_tokens": 18558.0,
      "step": 10373,
      "turn_loss": 0.2988569140434265,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.4819736108530013,
      "grad_norm": 0.37580451369285583,
      "learning_rate": 4.5569270112392037e-07,
      "loss": 0.1092,
      "mae_dtheta": 0.03125983849167824,
      "mae_dx": 0.008739029988646507,
      "mae_dy": 0.0045815580524504185,
      "pose_mae_dtheta": 0.24210074543952942,
      "pose_mae_dx": 0.06623785942792892,
      "pose_mae_dy": 0.05212140083312988,
      "pose_rmse_dtheta": 0.4387434124946594,
      "pose_rmse_dx": 0.15635737776756287,
      "pose_rmse_dy": 0.12157752364873886,
      "pose_rmse_mean": 0.23889276385307312,
      "rmse_dtheta": 0.05034201964735985,
      "rmse_dx": 0.01936587132513523,
      "rmse_dy": 0.010991550981998444,
      "rmse_mean": 0.02689981460571289,
      "rotation_flip": 0.004854368977248669,
      "sparse_tokens": 6984.0,
      "step": 10374,
      "turn_loss": 0.2807735204696655,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.48202007061884405,
      "grad_norm": 0.3666837811470032,
      "learning_rate": 4.551413649015113e-07,
      "loss": 0.0684,
      "mae_dtheta": 0.03611904755234718,
      "mae_dx": 0.00875523779541254,
      "mae_dy": 0.003150692442432046,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.36668381094932556,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.1833953857422,
      "model/head/act_norm_mean": 98.79368681066177,
      "model/head/act_norm_min": 73.0094223022461,
      "model/head/act_over_embed": 67.89194649735506,
      "model/head/grad_frac": 0.0959557592868805,
      "model/head/grad_norm": 0.035185422748327255,
      "model/head/grad_zero_frac": 0.00021733116591349244,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6967917049632353,
      "model/head/update_ratio": 0.0005989820347167552,
      "model/head/weight_delta": 9.965801239013672,
      "model/head/weight_delta_rel": 0.17482967674732208,
      "model/head/weight_norm": 58.742034912109375,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.422789067029953,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.422789067029953,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.422789067029953,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905446050765919,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09684646129608154,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03551203012466431,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011466607684269547,
      "model/modality_embedder.encoders.pose/weight_delta": 3.152209520339966,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10299251228570938,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969951629638672,
      "model/modality_embedder/grad_frac": 0.09684646129608154,
      "model/modality_embedder/grad_norm": 0.03551203012466431,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0011466607684269547,
      "model/modality_embedder/weight_delta": 3.152209520339966,
      "model/modality_embedder/weight_delta_rel": 0.10299251228570938,
      "model/modality_embedder/weight_norm": 30.969951629638672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.52093505859375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.555551908263304,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.175206184387207,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.50038643976252,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0650198757648468,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0238417349755764,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008527433965355158,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7317872047424316,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09954797476530075,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.9588623046875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.1906509399414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.33740918242297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.714947700500488,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.03768607842817,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06674563884735107,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.024474546313285828,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008222021861001849,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.46366024017334,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.11998389661312103,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.767065048217773,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.02281188964844,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.930850986227824,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.030102729797363,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.13271420404007,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07074546068906784,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.025941215455532074,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008439368102699518,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.751873016357422,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12598086893558502,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.738338470458984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.90528106689453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.77446056547619,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.862943649291992,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.399659967044364,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07417972385883331,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.027200503274798393,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009081283933483064,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2239928245544434,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11018077284097672,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.952266693115234,
      "model/normalizer/grad_frac": 0.2899288535118103,
      "model/normalizer/grad_norm": 0.10631221532821655,
      "model/normalizer/grad_zero_frac": 0.00018907814228441566,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0013516488252207637,
      "model/normalizer/weight_delta": 6.7822041511535645,
      "model/normalizer/weight_delta_rel": 0.08735086023807526,
      "model/normalizer/weight_norm": 78.65372467041016,
      "pose_mae_dtheta": 0.2925778031349182,
      "pose_mae_dx": 0.06238074228167534,
      "pose_mae_dy": 0.03817920386791229,
      "pose_rmse_dtheta": 0.523993194103241,
      "pose_rmse_dx": 0.14613842964172363,
      "pose_rmse_dy": 0.09298601746559143,
      "pose_rmse_mean": 0.25437256693840027,
      "rmse_dtheta": 0.05605604127049446,
      "rmse_dx": 0.019936179742217064,
      "rmse_dy": 0.006091320421546698,
      "rmse_mean": 0.027361180633306503,
      "rotation_flip": 0.009109311737120152,
      "sparse_tokens": 17017.0,
      "step": 10375,
      "turn_loss": 0.23662875592708588,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4820665303846869,
      "grad_norm": 0.8253298401832581,
      "learning_rate": 4.5459034650350453e-07,
      "loss": 0.0881,
      "mae_dtheta": 0.008163227699697018,
      "mae_dx": 0.001409791992045939,
      "mae_dy": 0.0011815913021564484,
      "pose_mae_dtheta": 0.05697029456496239,
      "pose_mae_dx": 0.012962089851498604,
      "pose_mae_dy": 0.01629823073744774,
      "pose_rmse_dtheta": 0.1844392567873001,
      "pose_rmse_dx": 0.0364593081176281,
      "pose_rmse_dy": 0.039199672639369965,
      "pose_rmse_mean": 0.08669941872358322,
      "rmse_dtheta": 0.02255263179540634,
      "rmse_dx": 0.004828942473977804,
      "rmse_dy": 0.002704801969230175,
      "rmse_mean": 0.010028792545199394,
      "rotation_flip": 0.0038419319316744804,
      "sparse_tokens": 32089.0,
      "step": 10376,
      "turn_loss": 0.0557267852127552,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.48211299015052966,
      "grad_norm": 0.3910427987575531,
      "learning_rate": 4.5403964596843484e-07,
      "loss": 0.0805,
      "mae_dtheta": 0.0385177843272686,
      "mae_dx": 0.00432470440864563,
      "mae_dy": 0.009441100992262363,
      "pose_mae_dtheta": 0.3240309953689575,
      "pose_mae_dx": 0.07126542180776596,
      "pose_mae_dy": 0.15124620497226715,
      "pose_rmse_dtheta": 0.5452271103858948,
      "pose_rmse_dx": 0.1507038027048111,
      "pose_rmse_dy": 0.32199546694755554,
      "pose_rmse_mean": 0.33930879831314087,
      "rmse_dtheta": 0.057573433965444565,
      "rmse_dx": 0.009926478378474712,
      "rmse_dy": 0.015721280127763748,
      "rmse_mean": 0.027740400284528732,
      "rotation_flip": 0.004950494971126318,
      "sparse_tokens": 3807.0,
      "step": 10377,
      "turn_loss": 0.300313800573349,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.48215944991637244,
      "grad_norm": 0.9582438468933105,
      "learning_rate": 4.534892633348137e-07,
      "loss": 0.2435,
      "mae_dtheta": 0.02646109089255333,
      "mae_dx": 0.011561631225049496,
      "mae_dy": 0.0038580908440053463,
      "pose_mae_dtheta": 0.1941278725862503,
      "pose_mae_dx": 0.08572681993246078,
      "pose_mae_dy": 0.0519283264875412,
      "pose_rmse_dtheta": 0.37744787335395813,
      "pose_rmse_dx": 0.20190311968326569,
      "pose_rmse_dy": 0.13240700960159302,
      "pose_rmse_mean": 0.23725268244743347,
      "rmse_dtheta": 0.043908942490816116,
      "rmse_dx": 0.02471623197197914,
      "rmse_dy": 0.00798048172146082,
      "rmse_mean": 0.0255352184176445,
      "rotation_flip": 0.011142061091959476,
      "sparse_tokens": 12456.0,
      "step": 10378,
      "turn_loss": 0.22019942104816437,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4822059096822152,
      "grad_norm": 0.43421822786331177,
      "learning_rate": 4.52939198641128e-07,
      "loss": 0.0991,
      "mae_dtheta": 0.006603853311389685,
      "mae_dx": 0.0012318515218794346,
      "mae_dy": 0.0012199925258755684,
      "pose_mae_dtheta": 0.040637094527482986,
      "pose_mae_dx": 0.01043605711311102,
      "pose_mae_dy": 0.011943046934902668,
      "pose_rmse_dtheta": 0.13674238324165344,
      "pose_rmse_dx": 0.028329219669103622,
      "pose_rmse_dy": 0.03722013533115387,
      "pose_rmse_mean": 0.06743058562278748,
      "rmse_dtheta": 0.019921772181987762,
      "rmse_dx": 0.004093436058610678,
      "rmse_dy": 0.004077304154634476,
      "rmse_mean": 0.009364170953631401,
      "rotation_flip": 0.00554994959384203,
      "sparse_tokens": 32105.0,
      "step": 10379,
      "turn_loss": 0.05924249812960625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.482252369448058,
      "grad_norm": 0.3888005316257477,
      "learning_rate": 4.523894519258448e-07,
      "loss": 0.0938,
      "mae_dtheta": 0.005023676436394453,
      "mae_dx": 0.0009415862732566893,
      "mae_dy": 0.0004063342057634145,
      "pose_mae_dtheta": 0.033374156802892685,
      "pose_mae_dx": 0.00774902431294322,
      "pose_mae_dy": 0.006374499294906855,
      "pose_rmse_dtheta": 0.15375161170959473,
      "pose_rmse_dx": 0.021522844210267067,
      "pose_rmse_dy": 0.026321541517972946,
      "pose_rmse_mean": 0.06719867140054703,
      "rmse_dtheta": 0.021006690338253975,
      "rmse_dx": 0.002874211175367236,
      "rmse_dy": 0.0014189161593094468,
      "rmse_mean": 0.008433273062109947,
      "rotation_flip": 0.0006775067886337638,
      "sparse_tokens": 32153.0,
      "step": 10380,
      "turn_loss": 0.04011799022555351,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.48229882921390077,
      "grad_norm": 0.5173991322517395,
      "learning_rate": 4.5184002322740784e-07,
      "loss": 0.1024,
      "mae_dtheta": 0.02598743513226509,
      "mae_dx": 0.0029593361541628838,
      "mae_dy": 0.004509572871029377,
      "pose_mae_dtheta": 0.2222394347190857,
      "pose_mae_dx": 0.04238269478082657,
      "pose_mae_dy": 0.0893971398472786,
      "pose_rmse_dtheta": 0.33616650104522705,
      "pose_rmse_dx": 0.07987316697835922,
      "pose_rmse_dy": 0.16920551657676697,
      "pose_rmse_mean": 0.19508174061775208,
      "rmse_dtheta": 0.03755645826458931,
      "rmse_dx": 0.007201575208455324,
      "rmse_dy": 0.007459184154868126,
      "rmse_mean": 0.017405739054083824,
      "rotation_flip": 0.009933775290846825,
      "sparse_tokens": 4689.0,
      "step": 10381,
      "turn_loss": 0.20171275734901428,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.48234528897974355,
      "grad_norm": 0.6023620367050171,
      "learning_rate": 4.5129091258424017e-07,
      "loss": 0.1148,
      "mae_dtheta": 0.01155003346502781,
      "mae_dx": 0.0030146120116114616,
      "mae_dy": 0.0038420427590608597,
      "pose_mae_dtheta": 0.07705127447843552,
      "pose_mae_dx": 0.03636058792471886,
      "pose_mae_dy": 0.03654289245605469,
      "pose_rmse_dtheta": 0.16103224456310272,
      "pose_rmse_dx": 0.10203922539949417,
      "pose_rmse_dy": 0.07748919725418091,
      "pose_rmse_mean": 0.11352022737264633,
      "rmse_dtheta": 0.02225939929485321,
      "rmse_dx": 0.008803503587841988,
      "rmse_dy": 0.007953519932925701,
      "rmse_mean": 0.013005474582314491,
      "rotation_flip": 0.002877697814255953,
      "sparse_tokens": 32105.0,
      "step": 10382,
      "turn_loss": 0.11380764842033386,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.4823917487455863,
      "grad_norm": 0.996345043182373,
      "learning_rate": 4.507421200347389e-07,
      "loss": 0.2558,
      "mae_dtheta": 0.04342031106352806,
      "mae_dx": 0.013224763795733452,
      "mae_dy": 0.0053796786814928055,
      "pose_mae_dtheta": 0.3540244698524475,
      "pose_mae_dx": 0.10538701713085175,
      "pose_mae_dy": 0.06297939270734787,
      "pose_rmse_dtheta": 0.6070939898490906,
      "pose_rmse_dx": 0.2547489404678345,
      "pose_rmse_dy": 0.1907484084367752,
      "pose_rmse_mean": 0.3508637845516205,
      "rmse_dtheta": 0.0620388425886631,
      "rmse_dx": 0.02638557180762291,
      "rmse_dy": 0.01413610577583313,
      "rmse_mean": 0.03418684005737305,
      "rotation_flip": 0.019157087430357933,
      "sparse_tokens": 11982.0,
      "step": 10383,
      "turn_loss": 0.31360697746276855,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.4824382085114291,
      "grad_norm": 0.48075053095817566,
      "learning_rate": 4.501936456172845e-07,
      "loss": 0.1378,
      "mae_dtheta": 0.026790069416165352,
      "mae_dx": 0.011283431202173233,
      "mae_dy": 0.004913600627332926,
      "pose_mae_dtheta": 0.18346458673477173,
      "pose_mae_dx": 0.09824419766664505,
      "pose_mae_dy": 0.05506111681461334,
      "pose_rmse_dtheta": 0.33085623383522034,
      "pose_rmse_dx": 0.22881285846233368,
      "pose_rmse_dy": 0.10713940113782883,
      "pose_rmse_mean": 0.22226950526237488,
      "rmse_dtheta": 0.04161000996828079,
      "rmse_dx": 0.0241101011633873,
      "rmse_dy": 0.010158858262002468,
      "rmse_mean": 0.02529299072921276,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 9717.0,
      "step": 10384,
      "turn_loss": 0.2774765193462372,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4824846682772719,
      "grad_norm": 0.42756977677345276,
      "learning_rate": 4.496454893702301e-07,
      "loss": 0.0952,
      "mae_dtheta": 0.011289989575743675,
      "mae_dx": 0.0014238785952329636,
      "mae_dy": 0.002067083492875099,
      "pose_mae_dtheta": 0.074226975440979,
      "pose_mae_dx": 0.015913313254714012,
      "pose_mae_dy": 0.018783502280712128,
      "pose_rmse_dtheta": 0.23891671001911163,
      "pose_rmse_dx": 0.044312771409749985,
      "pose_rmse_dy": 0.04874525964260101,
      "pose_rmse_mean": 0.11065825074911118,
      "rmse_dtheta": 0.02895907498896122,
      "rmse_dx": 0.0041627176105976105,
      "rmse_dy": 0.005996115505695343,
      "rmse_mean": 0.013039303943514824,
      "rotation_flip": 0.005972696468234062,
      "sparse_tokens": 32137.0,
      "step": 10385,
      "turn_loss": 0.08458960056304932,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.48253112804311465,
      "grad_norm": 0.31075721979141235,
      "learning_rate": 4.4909765133190787e-07,
      "loss": 0.068,
      "mae_dtheta": 0.02839173935353756,
      "mae_dx": 0.006351913791149855,
      "mae_dy": 0.003758209990337491,
      "pose_mae_dtheta": 0.23144438862800598,
      "pose_mae_dx": 0.057514965534210205,
      "pose_mae_dy": 0.0635887011885643,
      "pose_rmse_dtheta": 0.42385661602020264,
      "pose_rmse_dx": 0.16126622259616852,
      "pose_rmse_dy": 0.17076845467090607,
      "pose_rmse_mean": 0.2519637644290924,
      "rmse_dtheta": 0.04584652557969093,
      "rmse_dx": 0.017460312694311142,
      "rmse_dy": 0.007719737011939287,
      "rmse_mean": 0.023675527423620224,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 6290.0,
      "step": 10386,
      "turn_loss": 0.17424903810024261,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 39790.0,
      "epoch": 0.48257758780895743,
      "grad_norm": 0.9386622309684753,
      "learning_rate": 4.48550131540631e-07,
      "loss": 0.2651,
      "mae_dtheta": 0.036818522959947586,
      "mae_dx": 0.013841151259839535,
      "mae_dy": 0.005815824028104544,
      "pose_mae_dtheta": 0.2961459755897522,
      "pose_mae_dx": 0.11437743902206421,
      "pose_mae_dy": 0.06964336335659027,
      "pose_rmse_dtheta": 0.5270667672157288,
      "pose_rmse_dx": 0.2549518942832947,
      "pose_rmse_dy": 0.1712028682231903,
      "pose_rmse_mean": 0.3177405297756195,
      "rmse_dtheta": 0.05492069199681282,
      "rmse_dx": 0.026996400207281113,
      "rmse_dy": 0.013153506442904472,
      "rmse_mean": 0.03169020265340805,
      "rotation_flip": 0.01425178162753582,
      "sparse_tokens": 29890.0,
      "step": 10387,
      "turn_loss": 0.27175816893577576,
      "turns": 123.0,
      "turns_per_sample": 123.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4826240475748002,
      "grad_norm": 0.5234584212303162,
      "learning_rate": 4.4800293003468497e-07,
      "loss": 0.1127,
      "mae_dtheta": 0.006054747849702835,
      "mae_dx": 0.001966961193829775,
      "mae_dy": 0.000807717617135495,
      "pose_mae_dtheta": 0.043047428131103516,
      "pose_mae_dx": 0.0179546307772398,
      "pose_mae_dy": 0.014082730747759342,
      "pose_rmse_dtheta": 0.17744559049606323,
      "pose_rmse_dx": 0.0695732906460762,
      "pose_rmse_dy": 0.053764212876558304,
      "pose_rmse_mean": 0.10026103258132935,
      "rmse_dtheta": 0.021881377324461937,
      "rmse_dx": 0.008319691754877567,
      "rmse_dy": 0.002552396384999156,
      "rmse_mean": 0.01091782283037901,
      "rotation_flip": 0.0,
      "sparse_tokens": 32105.0,
      "step": 10388,
      "turn_loss": 0.07027067989110947,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.482670507340643,
      "grad_norm": 0.601546049118042,
      "learning_rate": 4.4745604685233756e-07,
      "loss": 0.1767,
      "mae_dtheta": 0.036327678710222244,
      "mae_dx": 0.015601719729602337,
      "mae_dy": 0.008795890025794506,
      "pose_mae_dtheta": 0.2930426597595215,
      "pose_mae_dx": 0.1240047886967659,
      "pose_mae_dy": 0.11605001986026764,
      "pose_rmse_dtheta": 0.4802347719669342,
      "pose_rmse_dx": 0.285125195980072,
      "pose_rmse_dy": 0.22099964320659637,
      "pose_rmse_mean": 0.32878655195236206,
      "rmse_dtheta": 0.05186240002512932,
      "rmse_dx": 0.03120478428900242,
      "rmse_dy": 0.015558001585304737,
      "rmse_mean": 0.03287506476044655,
      "rotation_flip": 0.017879948019981384,
      "sparse_tokens": 13216.0,
      "step": 10389,
      "turn_loss": 0.4364699721336365,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.48271696710648576,
      "grad_norm": 0.7439896464347839,
      "learning_rate": 4.469094820318326e-07,
      "loss": 0.1586,
      "mae_dtheta": 0.03904794156551361,
      "mae_dx": 0.021186165511608124,
      "mae_dy": 0.00983550027012825,
      "pose_mae_dtheta": 0.27082696557044983,
      "pose_mae_dx": 0.1469954550266266,
      "pose_mae_dy": 0.11362900584936142,
      "pose_rmse_dtheta": 0.418344110250473,
      "pose_rmse_dx": 0.2665744125843048,
      "pose_rmse_dy": 0.26900342106819153,
      "pose_rmse_mean": 0.3179739713668823,
      "rmse_dtheta": 0.05688801780343056,
      "rmse_dx": 0.033076561987400055,
      "rmse_dy": 0.019389590248465538,
      "rmse_mean": 0.036451391875743866,
      "rotation_flip": 0.014563106931746006,
      "sparse_tokens": 3405.0,
      "step": 10390,
      "turn_loss": 0.4467279016971588,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.48276342687232854,
      "grad_norm": 0.8037549257278442,
      "learning_rate": 4.4636323561139115e-07,
      "loss": 0.1527,
      "mae_dtheta": 0.008867383003234863,
      "mae_dx": 0.0015418381663039327,
      "mae_dy": 0.0017956554656848311,
      "pose_mae_dtheta": 0.0681358277797699,
      "pose_mae_dx": 0.01612911745905876,
      "pose_mae_dy": 0.023323452100157738,
      "pose_rmse_dtheta": 0.1907873898744583,
      "pose_rmse_dx": 0.05036872997879982,
      "pose_rmse_dy": 0.07598599046468735,
      "pose_rmse_mean": 0.10571403801441193,
      "rmse_dtheta": 0.022708231583237648,
      "rmse_dx": 0.005489259958267212,
      "rmse_dy": 0.006130844354629517,
      "rmse_mean": 0.011442778632044792,
      "rotation_flip": 0.0031289111357182264,
      "sparse_tokens": 32057.0,
      "step": 10391,
      "turn_loss": 0.06560473144054413,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.48280988663817137,
      "grad_norm": 0.33802637457847595,
      "learning_rate": 4.4581730762921327e-07,
      "loss": 0.0798,
      "mae_dtheta": 0.03505750373005867,
      "mae_dx": 0.010275573469698429,
      "mae_dy": 0.005074311979115009,
      "pose_mae_dtheta": 0.2590808570384979,
      "pose_mae_dx": 0.0798138901591301,
      "pose_mae_dy": 0.06433123350143433,
      "pose_rmse_dtheta": 0.4769340455532074,
      "pose_rmse_dx": 0.1729021966457367,
      "pose_rmse_dy": 0.1453443318605423,
      "pose_rmse_mean": 0.2650601863861084,
      "rmse_dtheta": 0.054136183112859726,
      "rmse_dx": 0.02113318257033825,
      "rmse_dy": 0.009710569866001606,
      "rmse_mean": 0.028326645493507385,
      "rotation_flip": 0.015643803402781487,
      "sparse_tokens": 13298.0,
      "step": 10392,
      "turn_loss": 0.2614412307739258,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.48285634640401415,
      "grad_norm": 0.4316237270832062,
      "learning_rate": 4.4527169812347446e-07,
      "loss": 0.0908,
      "mae_dtheta": 0.010101963765919209,
      "mae_dx": 0.001858848030678928,
      "mae_dy": 0.002520128386095166,
      "pose_mae_dtheta": 0.06759531050920486,
      "pose_mae_dx": 0.014623920433223248,
      "pose_mae_dy": 0.025206202641129494,
      "pose_rmse_dtheta": 0.15491625666618347,
      "pose_rmse_dx": 0.039880797266960144,
      "pose_rmse_dy": 0.05829663202166557,
      "pose_rmse_mean": 0.08436456322669983,
      "rmse_dtheta": 0.02149324305355549,
      "rmse_dx": 0.006101807579398155,
      "rmse_dy": 0.006931142881512642,
      "rmse_mean": 0.011508731171488762,
      "rotation_flip": 0.009118541143834591,
      "sparse_tokens": 32105.0,
      "step": 10393,
      "turn_loss": 0.08970437198877335,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.4829028061698569,
      "grad_norm": 0.4661569893360138,
      "learning_rate": 4.447264071323315e-07,
      "loss": 0.0826,
      "mae_dtheta": 0.008064066991209984,
      "mae_dx": 0.0013867308152839541,
      "mae_dy": 0.0005091266357339919,
      "pose_mae_dtheta": 0.06174401193857193,
      "pose_mae_dx": 0.011256891302764416,
      "pose_mae_dy": 0.005761441774666309,
      "pose_rmse_dtheta": 0.26824358105659485,
      "pose_rmse_dx": 0.028501449152827263,
      "pose_rmse_dy": 0.023813333362340927,
      "pose_rmse_mean": 0.10685279220342636,
      "rmse_dtheta": 0.02903822250664234,
      "rmse_dx": 0.004022058565169573,
      "rmse_dy": 0.002458485309034586,
      "rmse_mean": 0.011839590035378933,
      "rotation_flip": 0.0027639579493552446,
      "sparse_tokens": 32217.0,
      "step": 10394,
      "turn_loss": 0.048694465309381485,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4829492659356997,
      "grad_norm": 0.5085696578025818,
      "learning_rate": 4.4418143469391497e-07,
      "loss": 0.1098,
      "mae_dtheta": 0.011280757375061512,
      "mae_dx": 0.001423966488800943,
      "mae_dy": 0.0027126120403409004,
      "pose_mae_dtheta": 0.07311516255140305,
      "pose_mae_dx": 0.02180614322423935,
      "pose_mae_dy": 0.03220464661717415,
      "pose_rmse_dtheta": 0.16260603070259094,
      "pose_rmse_dx": 0.056330230087041855,
      "pose_rmse_dy": 0.06905316561460495,
      "pose_rmse_mean": 0.09599648416042328,
      "rmse_dtheta": 0.022760696709156036,
      "rmse_dx": 0.004433016758412123,
      "rmse_dy": 0.006200733128935099,
      "rmse_mean": 0.011131483130156994,
      "rotation_flip": 0.006172839552164078,
      "sparse_tokens": 32073.0,
      "step": 10395,
      "turn_loss": 0.0954078733921051,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4829957257015425,
      "grad_norm": 0.43014341592788696,
      "learning_rate": 4.43636780846336e-07,
      "loss": 0.0971,
      "mae_dtheta": 0.010742789134383202,
      "mae_dx": 0.002049422822892666,
      "mae_dy": 0.002778387628495693,
      "pose_mae_dtheta": 0.0765746459364891,
      "pose_mae_dx": 0.01977561227977276,
      "pose_mae_dy": 0.026551418006420135,
      "pose_rmse_dtheta": 0.1781477928161621,
      "pose_rmse_dx": 0.05326371267437935,
      "pose_rmse_dy": 0.0569528229534626,
      "pose_rmse_mean": 0.09612144529819489,
      "rmse_dtheta": 0.022024493664503098,
      "rmse_dx": 0.006186065264046192,
      "rmse_dy": 0.0061539653688669205,
      "rmse_mean": 0.011454841122031212,
      "rotation_flip": 0.009661835618317127,
      "sparse_tokens": 32121.0,
      "step": 10396,
      "turn_loss": 0.09754209965467453,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.48304218546738525,
      "grad_norm": 0.6873593330383301,
      "learning_rate": 4.430924456276836e-07,
      "loss": 0.1425,
      "mae_dtheta": 0.011148841120302677,
      "mae_dx": 0.0016676062950864434,
      "mae_dy": 0.0032140740659087896,
      "pose_mae_dtheta": 0.07302800565958023,
      "pose_mae_dx": 0.024731677025556564,
      "pose_mae_dy": 0.032685041427612305,
      "pose_rmse_dtheta": 0.16816596686840057,
      "pose_rmse_dx": 0.054613351821899414,
      "pose_rmse_dy": 0.0664510577917099,
      "pose_rmse_mean": 0.0964101254940033,
      "rmse_dtheta": 0.02174564078450203,
      "rmse_dx": 0.003990136086940765,
      "rmse_dy": 0.005903568584471941,
      "rmse_mean": 0.010546448640525341,
      "rotation_flip": 0.005526658147573471,
      "sparse_tokens": 32105.0,
      "step": 10397,
      "turn_loss": 0.09504881501197815,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.48308864523322803,
      "grad_norm": 0.48516711592674255,
      "learning_rate": 4.4254842907602123e-07,
      "loss": 0.1414,
      "mae_dtheta": 0.00975737627595663,
      "mae_dx": 0.001740713487379253,
      "mae_dy": 0.0022409807424992323,
      "pose_mae_dtheta": 0.06213444471359253,
      "pose_mae_dx": 0.02383163757622242,
      "pose_mae_dy": 0.029723595827817917,
      "pose_rmse_dtheta": 0.1264697015285492,
      "pose_rmse_dx": 0.06038608029484749,
      "pose_rmse_dy": 0.06680566817522049,
      "pose_rmse_mean": 0.08455382287502289,
      "rmse_dtheta": 0.018834516406059265,
      "rmse_dx": 0.0050981612876057625,
      "rmse_dy": 0.004506630357354879,
      "rmse_mean": 0.009479769505560398,
      "rotation_flip": 0.004775899928063154,
      "sparse_tokens": 32089.0,
      "step": 10398,
      "turn_loss": 0.08531796187162399,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28550.0,
      "epoch": 0.4831351049990708,
      "grad_norm": 0.4533052146434784,
      "learning_rate": 4.420047312293946e-07,
      "loss": 0.1083,
      "mae_dtheta": 0.02693084068596363,
      "mae_dx": 0.010244322009384632,
      "mae_dy": 0.004550857935100794,
      "pose_mae_dtheta": 0.1993337720632553,
      "pose_mae_dx": 0.07892477512359619,
      "pose_mae_dy": 0.07497560977935791,
      "pose_rmse_dtheta": 0.35454368591308594,
      "pose_rmse_dx": 0.2138110250234604,
      "pose_rmse_dy": 0.15182144939899445,
      "pose_rmse_mean": 0.24005872011184692,
      "rmse_dtheta": 0.04200934246182442,
      "rmse_dx": 0.023671241477131844,
      "rmse_dy": 0.008636046200990677,
      "rmse_mean": 0.02477221190929413,
      "rotation_flip": 0.0164930559694767,
      "sparse_tokens": 24161.0,
      "step": 10399,
      "turn_loss": 0.2058553248643875,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4831815647649136,
      "grad_norm": 0.44743236899375916,
      "learning_rate": 4.414613521258221e-07,
      "loss": 0.1231,
      "mae_dtheta": 0.010860206559300423,
      "mae_dx": 0.002142395591363311,
      "mae_dy": 0.0026719297748059034,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.447432279586792,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.59877014160156,
      "model/head/act_norm_mean": 104.69258009785354,
      "model/head/act_norm_min": 58.514190673828125,
      "model/head/act_over_embed": 71.9457211906223,
      "model/head/grad_frac": 0.11147762835025787,
      "model/head/grad_norm": 0.049878690391778946,
      "model/head/grad_zero_frac": 0.00019766030891332775,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7042495265151515,
      "model/head/update_ratio": 0.0008491125190630555,
      "model/head/weight_delta": 9.966510772705078,
      "model/head/weight_delta_rel": 0.17484211921691895,
      "model/head/weight_norm": 58.74214553833008,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42285647988319397,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42278541867428415,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227246940135956,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29054209789241986,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11358045786619186,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05081956461071968,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5485527946035242,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001640931237488985,
      "model/modality_embedder.encoders.pose/weight_delta": 3.152462959289551,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10300078988075256,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969953536987305,
      "model/modality_embedder/grad_frac": 0.11358045786619186,
      "model/modality_embedder/grad_norm": 0.05081956461071968,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5485527946035242,
      "model/modality_embedder/update_ratio": 0.001640931237488985,
      "model/modality_embedder/weight_delta": 3.152462959289551,
      "model/modality_embedder/weight_delta_rel": 0.10300078988075256,
      "model/modality_embedder/weight_norm": 30.969953536987305,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.71066284179688,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.140096400513066,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.086328506469727,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.902090887428315,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.061025671660900116,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02730485610663891,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.000976605573669076,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.732306957244873,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09956691414117813,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.958938598632812,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 94.38887786865234,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.10317961359628,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.448304176330566,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.563930687986197,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06358052790164948,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.028447981923818588,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009556803852319717,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.464277982711792,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1200052946805954,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.767255783081055,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.98983001708984,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.928095438512106,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.590068817138672,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.818029927999486,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06013272702693939,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.026905322447419167,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008752975845709443,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7525179386138916,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12600252032279968,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.73848533630371,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.48925018310547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.662683381433382,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.504671096801758,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.010055001843167,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.054199013859033585,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.024250388145446777,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00032783247297629714,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008096299134194851,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2246596813201904,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1102035641670227,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.952436447143555,
      "model/normalizer/grad_frac": 0.17997302114963531,
      "model/normalizer/grad_norm": 0.08052574098110199,
      "model/normalizer/grad_zero_frac": 0.0002753450535237789,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001023798598907888,
      "model/normalizer/weight_delta": 6.783457279205322,
      "model/normalizer/weight_delta_rel": 0.08736700564622879,
      "model/normalizer/weight_norm": 78.65388488769531,
      "pose_mae_dtheta": 0.07558353990316391,
      "pose_mae_dx": 0.01978621818125248,
      "pose_mae_dy": 0.022208688780665398,
      "pose_rmse_dtheta": 0.20338799059391022,
      "pose_rmse_dx": 0.05977017432451248,
      "pose_rmse_dy": 0.047025952488183975,
      "pose_rmse_mean": 0.10339470952749252,
      "rmse_dtheta": 0.02449585497379303,
      "rmse_dx": 0.00667846342548728,
      "rmse_dy": 0.007076389621943235,
      "rmse_mean": 0.012750236317515373,
      "rotation_flip": 0.004203152377158403,
      "sparse_tokens": 32137.0,
      "step": 10400,
      "turn_loss": 0.09387677162885666,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.4831815647649136,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3009309470653534,
      "eval_objectnav_nopose_mae_dtheta": 0.03983508050441742,
      "eval_objectnav_nopose_mae_dx": 0.013142627663910389,
      "eval_objectnav_nopose_mae_dy": 0.0050887432880699635,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31755921244621277,
      "eval_objectnav_nopose_pose_mae_dx": 0.1046421155333519,
      "eval_objectnav_nopose_pose_mae_dy": 0.05390941724181175,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5369496941566467,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23159188032150269,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12870173156261444,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29908111691474915,
      "eval_objectnav_nopose_rmse_dtheta": 0.05771499499678612,
      "eval_objectnav_nopose_rmse_dx": 0.025795919820666313,
      "eval_objectnav_nopose_rmse_dy": 0.010505233891308308,
      "eval_objectnav_nopose_rmse_mean": 0.03133871778845787,
      "eval_objectnav_nopose_rotation_flip": 0.01582297310233116,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3009309470653534,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 10400
    },
    {
      "epoch": 0.4831815647649136,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2718002498149872,
      "eval_objectnav_pose_mae_dtheta": 0.03471946716308594,
      "eval_objectnav_pose_mae_dx": 0.010909674689173698,
      "eval_objectnav_pose_mae_dy": 0.004622353706508875,
      "eval_objectnav_pose_pose_mae_dtheta": 0.25686758756637573,
      "eval_objectnav_pose_pose_mae_dx": 0.08508272469043732,
      "eval_objectnav_pose_pose_mae_dy": 0.04759164899587631,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4563925564289093,
      "eval_objectnav_pose_pose_rmse_dx": 0.19898459315299988,
      "eval_objectnav_pose_pose_rmse_dy": 0.11580721288919449,
      "eval_objectnav_pose_pose_rmse_mean": 0.2570614814758301,
      "eval_objectnav_pose_rmse_dtheta": 0.05247557908296585,
      "eval_objectnav_pose_rmse_dx": 0.022870350629091263,
      "eval_objectnav_pose_rmse_dy": 0.009813698939979076,
      "eval_objectnav_pose_rmse_mean": 0.028386544436216354,
      "eval_objectnav_pose_rotation_flip": 0.01615023799240589,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2718002498149872,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 10400
    },
    {
      "epoch": 0.4831815647649136,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08756006509065628,
      "eval_pointnav_mae_dtheta": 0.009915757924318314,
      "eval_pointnav_mae_dx": 0.0022105120588093996,
      "eval_pointnav_mae_dy": 0.002301829867064953,
      "eval_pointnav_pose_mae_dtheta": 0.06732641905546188,
      "eval_pointnav_pose_mae_dx": 0.02414380945265293,
      "eval_pointnav_pose_mae_dy": 0.023815877735614777,
      "eval_pointnav_pose_rmse_dtheta": 0.1963804066181183,
      "eval_pointnav_pose_rmse_dx": 0.07583343237638474,
      "eval_pointnav_pose_rmse_dy": 0.06881978362798691,
      "eval_pointnav_pose_rmse_mean": 0.11367788165807724,
      "eval_pointnav_rmse_dtheta": 0.02485942840576172,
      "eval_pointnav_rmse_dx": 0.007193190976977348,
      "eval_pointnav_rmse_dy": 0.00627686083316803,
      "eval_pointnav_rmse_mean": 0.012776494026184082,
      "eval_pointnav_rotation_flip": 0.005487088114023209,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08756006509065628,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 10400
    },
    {
      "epoch": 0.4831815647649136,
      "eval_loss": 0.22009708732366562,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.3009309470653534,
      "eval_objectnav_nopose_mae_dtheta": 0.03983508050441742,
      "eval_objectnav_nopose_mae_dx": 0.013142627663910389,
      "eval_objectnav_nopose_mae_dy": 0.0050887432880699635,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31755921244621277,
      "eval_objectnav_nopose_pose_mae_dx": 0.1046421155333519,
      "eval_objectnav_nopose_pose_mae_dy": 0.05390941724181175,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5369496941566467,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23159188032150269,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12870173156261444,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29908111691474915,
      "eval_objectnav_nopose_rmse_dtheta": 0.05771499499678612,
      "eval_objectnav_nopose_rmse_dx": 0.025795919820666313,
      "eval_objectnav_nopose_rmse_dy": 0.010505233891308308,
      "eval_objectnav_nopose_rmse_mean": 0.03133871778845787,
      "eval_objectnav_nopose_rotation_flip": 0.01582297310233116,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.3009309470653534,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2718002498149872,
      "eval_objectnav_pose_mae_dtheta": 0.03471946716308594,
      "eval_objectnav_pose_mae_dx": 0.010909674689173698,
      "eval_objectnav_pose_mae_dy": 0.004622353706508875,
      "eval_objectnav_pose_pose_mae_dtheta": 0.25686758756637573,
      "eval_objectnav_pose_pose_mae_dx": 0.08508272469043732,
      "eval_objectnav_pose_pose_mae_dy": 0.04759164899587631,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4563925564289093,
      "eval_objectnav_pose_pose_rmse_dx": 0.19898459315299988,
      "eval_objectnav_pose_pose_rmse_dy": 0.11580721288919449,
      "eval_objectnav_pose_pose_rmse_mean": 0.2570614814758301,
      "eval_objectnav_pose_rmse_dtheta": 0.05247557908296585,
      "eval_objectnav_pose_rmse_dx": 0.022870350629091263,
      "eval_objectnav_pose_rmse_dy": 0.009813698939979076,
      "eval_objectnav_pose_rmse_mean": 0.028386544436216354,
      "eval_objectnav_pose_rotation_flip": 0.01615023799240589,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2718002498149872,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08756006509065628,
      "eval_pointnav_mae_dtheta": 0.009915757924318314,
      "eval_pointnav_mae_dx": 0.0022105120588093996,
      "eval_pointnav_mae_dy": 0.002301829867064953,
      "eval_pointnav_pose_mae_dtheta": 0.06732641905546188,
      "eval_pointnav_pose_mae_dx": 0.02414380945265293,
      "eval_pointnav_pose_mae_dy": 0.023815877735614777,
      "eval_pointnav_pose_rmse_dtheta": 0.1963804066181183,
      "eval_pointnav_pose_rmse_dx": 0.07583343237638474,
      "eval_pointnav_pose_rmse_dy": 0.06881978362798691,
      "eval_pointnav_pose_rmse_mean": 0.11367788165807724,
      "eval_pointnav_rmse_dtheta": 0.02485942840576172,
      "eval_pointnav_rmse_dx": 0.007193190976977348,
      "eval_pointnav_rmse_dy": 0.00627686083316803,
      "eval_pointnav_rmse_mean": 0.012776494026184082,
      "eval_pointnav_rotation_flip": 0.005487088114023209,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08756006509065628,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 10400
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.48322802453075636,
      "grad_norm": 0.6435829997062683,
      "learning_rate": 4.4091829180330503e-07,
      "loss": 0.1524,
      "mae_dtheta": 0.0448036752641201,
      "mae_dx": 0.009901251643896103,
      "mae_dy": 0.003877955488860607,
      "pose_mae_dtheta": 0.36613908410072327,
      "pose_mae_dx": 0.07877130806446075,
      "pose_mae_dy": 0.044790878891944885,
      "pose_rmse_dtheta": 0.6077877283096313,
      "pose_rmse_dx": 0.1607959270477295,
      "pose_rmse_dy": 0.10704319924116135,
      "pose_rmse_mean": 0.2918756306171417,
      "rmse_dtheta": 0.06415724754333496,
      "rmse_dx": 0.019498376175761223,
      "rmse_dy": 0.00894180964678526,
      "rmse_mean": 0.030865810811519623,
      "rotation_flip": 0.01359003409743309,
      "sparse_tokens": 13130.0,
      "step": 10401,
      "turn_loss": 0.3428431451320648,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.48327448429659914,
      "grad_norm": 0.6168150305747986,
      "learning_rate": 4.4037555029981804e-07,
      "loss": 0.1435,
      "mae_dtheta": 0.013426375575363636,
      "mae_dx": 0.001649039681069553,
      "mae_dy": 0.0038669153582304716,
      "pose_mae_dtheta": 0.08958656340837479,
      "pose_mae_dx": 0.03311992436647415,
      "pose_mae_dy": 0.042146313935518265,
      "pose_rmse_dtheta": 0.18915867805480957,
      "pose_rmse_dx": 0.08782193064689636,
      "pose_rmse_dy": 0.09348735213279724,
      "pose_rmse_mean": 0.12348932027816772,
      "rmse_dtheta": 0.02392897754907608,
      "rmse_dx": 0.0040186443366110325,
      "rmse_dy": 0.007635950110852718,
      "rmse_mean": 0.01186119019985199,
      "rotation_flip": 0.006478781811892986,
      "sparse_tokens": 32073.0,
      "step": 10402,
      "turn_loss": 0.10692671686410904,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.4833209440624419,
      "grad_norm": 0.35800105333328247,
      "learning_rate": 4.398331276533158e-07,
      "loss": 0.091,
      "mae_dtheta": 0.03362160176038742,
      "mae_dx": 0.011216617189347744,
      "mae_dy": 0.008707411587238312,
      "pose_mae_dtheta": 0.26621949672698975,
      "pose_mae_dx": 0.09634160250425339,
      "pose_mae_dy": 0.09615025669336319,
      "pose_rmse_dtheta": 0.47250092029571533,
      "pose_rmse_dx": 0.21042755246162415,
      "pose_rmse_dy": 0.23408757150173187,
      "pose_rmse_mean": 0.3056720197200775,
      "rmse_dtheta": 0.0516132153570652,
      "rmse_dx": 0.02312055043876171,
      "rmse_dy": 0.018584052100777626,
      "rmse_mean": 0.03110593929886818,
      "rotation_flip": 0.016740087419748306,
      "sparse_tokens": 18594.0,
      "step": 10403,
      "turn_loss": 0.2924167811870575,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.4833674038282847,
      "grad_norm": 0.43654853105545044,
      "learning_rate": 4.392910239017317e-07,
      "loss": 0.0974,
      "mae_dtheta": 0.024988751858472824,
      "mae_dx": 0.01020217128098011,
      "mae_dy": 0.00377314118668437,
      "pose_mae_dtheta": 0.1865517944097519,
      "pose_mae_dx": 0.09104730933904648,
      "pose_mae_dy": 0.049458738416433334,
      "pose_rmse_dtheta": 0.3432992398738861,
      "pose_rmse_dx": 0.2141842395067215,
      "pose_rmse_dy": 0.14169730246067047,
      "pose_rmse_mean": 0.23306027054786682,
      "rmse_dtheta": 0.04020358622074127,
      "rmse_dx": 0.022559380158782005,
      "rmse_dy": 0.007829672656953335,
      "rmse_mean": 0.023530881851911545,
      "rotation_flip": 0.015250544995069504,
      "sparse_tokens": 17029.0,
      "step": 10404,
      "turn_loss": 0.21580052375793457,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.48341386359412747,
      "grad_norm": 0.6521140336990356,
      "learning_rate": 4.387492390829734e-07,
      "loss": 0.1473,
      "mae_dtheta": 0.03148508816957474,
      "mae_dx": 0.01148842554539442,
      "mae_dy": 0.006542479619383812,
      "pose_mae_dtheta": 0.23793856799602509,
      "pose_mae_dx": 0.08436841517686844,
      "pose_mae_dy": 0.09546595066785812,
      "pose_rmse_dtheta": 0.45531803369522095,
      "pose_rmse_dx": 0.19406571984291077,
      "pose_rmse_dy": 0.20247669517993927,
      "pose_rmse_mean": 0.2839534878730774,
      "rmse_dtheta": 0.049255404621362686,
      "rmse_dx": 0.023871181532740593,
      "rmse_dy": 0.011249564588069916,
      "rmse_mean": 0.028125382959842682,
      "rotation_flip": 0.008474576286971569,
      "sparse_tokens": 8873.0,
      "step": 10405,
      "turn_loss": 0.2069370150566101,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.48346032335997025,
      "grad_norm": 0.5612995624542236,
      "learning_rate": 4.382077732349299e-07,
      "loss": 0.1437,
      "mae_dtheta": 0.027934422716498375,
      "mae_dx": 0.007555488031357527,
      "mae_dy": 0.00696553522720933,
      "pose_mae_dtheta": 0.1907547265291214,
      "pose_mae_dx": 0.06003502383828163,
      "pose_mae_dy": 0.09150923043489456,
      "pose_rmse_dtheta": 0.4009009599685669,
      "pose_rmse_dx": 0.12828458845615387,
      "pose_rmse_dy": 0.22311842441558838,
      "pose_rmse_mean": 0.2507680058479309,
      "rmse_dtheta": 0.04766232520341873,
      "rmse_dx": 0.018935972824692726,
      "rmse_dy": 0.014166011475026608,
      "rmse_mean": 0.026921436190605164,
      "rotation_flip": 0.020512821152806282,
      "sparse_tokens": 3511.0,
      "step": 10406,
      "turn_loss": 0.19856320321559906,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.483506783125813,
      "grad_norm": 0.6559420228004456,
      "learning_rate": 4.376666263954643e-07,
      "loss": 0.1333,
      "mae_dtheta": 0.03156747296452522,
      "mae_dx": 0.012068258598446846,
      "mae_dy": 0.006816756911575794,
      "pose_mae_dtheta": 0.21932858228683472,
      "pose_mae_dx": 0.09823352843523026,
      "pose_mae_dy": 0.07164640724658966,
      "pose_rmse_dtheta": 0.4009381830692291,
      "pose_rmse_dx": 0.2297591120004654,
      "pose_rmse_dy": 0.18005909025669098,
      "pose_rmse_mean": 0.27025213837623596,
      "rmse_dtheta": 0.0508711040019989,
      "rmse_dx": 0.024751631543040276,
      "rmse_dy": 0.01542987022548914,
      "rmse_mean": 0.03035086952149868,
      "rotation_flip": 0.021377671509981155,
      "sparse_tokens": 14509.0,
      "step": 10407,
      "turn_loss": 0.27639490365982056,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.4835532428916558,
      "grad_norm": 0.3464764654636383,
      "learning_rate": 4.371257986024202e-07,
      "loss": 0.0822,
      "mae_dtheta": 0.028834588825702667,
      "mae_dx": 0.01591792143881321,
      "mae_dy": 0.009638722985982895,
      "pose_mae_dtheta": 0.2578587830066681,
      "pose_mae_dx": 0.1434219777584076,
      "pose_mae_dy": 0.09557858854532242,
      "pose_rmse_dtheta": 0.4432784914970398,
      "pose_rmse_dx": 0.26590871810913086,
      "pose_rmse_dy": 0.18469536304473877,
      "pose_rmse_mean": 0.29796087741851807,
      "rmse_dtheta": 0.044156529009342194,
      "rmse_dx": 0.027993392199277878,
      "rmse_dy": 0.020290952175855637,
      "rmse_mean": 0.03081362508237362,
      "rotation_flip": 0.016161616891622543,
      "sparse_tokens": 9335.0,
      "step": 10408,
      "turn_loss": 0.37616533041000366,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.48359970265749863,
      "grad_norm": 0.4962860643863678,
      "learning_rate": 4.3658528989361847e-07,
      "loss": 0.1088,
      "mae_dtheta": 0.05675609037280083,
      "mae_dx": 0.019997164607048035,
      "mae_dy": 0.0051364111714065075,
      "pose_mae_dtheta": 0.493832528591156,
      "pose_mae_dx": 0.14679452776908875,
      "pose_mae_dy": 0.0519266277551651,
      "pose_rmse_dtheta": 0.7644432187080383,
      "pose_rmse_dx": 0.2980710566043854,
      "pose_rmse_dy": 0.12772607803344727,
      "pose_rmse_mean": 0.39674681425094604,
      "rmse_dtheta": 0.07603288441896439,
      "rmse_dx": 0.03334426134824753,
      "rmse_dy": 0.010391093790531158,
      "rmse_mean": 0.039922747761011124,
      "rotation_flip": 0.020224718376994133,
      "sparse_tokens": 7435.0,
      "step": 10409,
      "turn_loss": 0.294932097196579,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.4836461624233414,
      "grad_norm": 0.59686279296875,
      "learning_rate": 4.3604510030685664e-07,
      "loss": 0.1082,
      "mae_dtheta": 0.0247057992964983,
      "mae_dx": 0.008994732052087784,
      "mae_dy": 0.0028663205448538065,
      "pose_mae_dtheta": 0.21729828417301178,
      "pose_mae_dx": 0.0813455879688263,
      "pose_mae_dy": 0.03419119492173195,
      "pose_rmse_dtheta": 0.4366294741630554,
      "pose_rmse_dx": 0.20048345625400543,
      "pose_rmse_dy": 0.08254151046276093,
      "pose_rmse_mean": 0.23988482356071472,
      "rmse_dtheta": 0.043552350252866745,
      "rmse_dx": 0.021024717018008232,
      "rmse_dy": 0.006375954486429691,
      "rmse_mean": 0.023651007562875748,
      "rotation_flip": 0.010256410576403141,
      "sparse_tokens": 17374.0,
      "step": 10410,
      "turn_loss": 0.17442026734352112,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4836926221891842,
      "grad_norm": 0.5283581614494324,
      "learning_rate": 4.355052298799112e-07,
      "loss": 0.0859,
      "mae_dtheta": 0.007635149639099836,
      "mae_dx": 0.002101336605846882,
      "mae_dy": 0.0010908936383202672,
      "pose_mae_dtheta": 0.06235025078058243,
      "pose_mae_dx": 0.018333585932850838,
      "pose_mae_dy": 0.01725160703063011,
      "pose_rmse_dtheta": 0.2033390998840332,
      "pose_rmse_dx": 0.05521019548177719,
      "pose_rmse_dy": 0.04741071164608002,
      "pose_rmse_mean": 0.10198666900396347,
      "rmse_dtheta": 0.021280884742736816,
      "rmse_dx": 0.007250047288835049,
      "rmse_dy": 0.002745554316788912,
      "rmse_mean": 0.01042549591511488,
      "rotation_flip": 0.002486016135662794,
      "sparse_tokens": 32105.0,
      "step": 10411,
      "turn_loss": 0.07127627730369568,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.48373908195502696,
      "grad_norm": 0.4209011197090149,
      "learning_rate": 4.349656786505341e-07,
      "loss": 0.1155,
      "mae_dtheta": 0.010625498369336128,
      "mae_dx": 0.0022330170031636953,
      "mae_dy": 0.0025687546003609896,
      "pose_mae_dtheta": 0.0699295699596405,
      "pose_mae_dx": 0.025647645816206932,
      "pose_mae_dy": 0.022730538621544838,
      "pose_rmse_dtheta": 0.1703861504793167,
      "pose_rmse_dx": 0.06626078486442566,
      "pose_rmse_dy": 0.04700904339551926,
      "pose_rmse_mean": 0.09455199539661407,
      "rmse_dtheta": 0.022894274443387985,
      "rmse_dx": 0.006159521173685789,
      "rmse_dy": 0.006453181151300669,
      "rmse_mean": 0.011835659854114056,
      "rotation_flip": 0.004333694465458393,
      "sparse_tokens": 32153.0,
      "step": 10412,
      "turn_loss": 0.09593360871076584,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.48378554172086974,
      "grad_norm": 0.4534728229045868,
      "learning_rate": 4.344264466564579e-07,
      "loss": 0.1089,
      "mae_dtheta": 0.028057610616087914,
      "mae_dx": 0.008204272016882896,
      "mae_dy": 0.0022067981772124767,
      "pose_mae_dtheta": 0.19254349172115326,
      "pose_mae_dx": 0.06426680833101273,
      "pose_mae_dy": 0.02432381920516491,
      "pose_rmse_dtheta": 0.44836631417274475,
      "pose_rmse_dx": 0.19256000220775604,
      "pose_rmse_dy": 0.053279340267181396,
      "pose_rmse_mean": 0.23140189051628113,
      "rmse_dtheta": 0.054084327071905136,
      "rmse_dx": 0.021028805524110794,
      "rmse_dy": 0.004537528846412897,
      "rmse_mean": 0.02655022218823433,
      "rotation_flip": 0.010309278033673763,
      "sparse_tokens": 8408.0,
      "step": 10413,
      "turn_loss": 0.1843002736568451,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 21033.0,
      "epoch": 0.4838320014867125,
      "grad_norm": 0.8288763761520386,
      "learning_rate": 4.338875339353904e-07,
      "loss": 0.1911,
      "mae_dtheta": 0.042622461915016174,
      "mae_dx": 0.013440883718430996,
      "mae_dy": 0.003364248899742961,
      "pose_mae_dtheta": 0.3668201267719269,
      "pose_mae_dx": 0.10797455161809921,
      "pose_mae_dy": 0.03868226334452629,
      "pose_rmse_dtheta": 0.5787233710289001,
      "pose_rmse_dx": 0.22671012580394745,
      "pose_rmse_dy": 0.12038253992795944,
      "pose_rmse_mean": 0.3086053729057312,
      "rmse_dtheta": 0.059880614280700684,
      "rmse_dx": 0.025818973779678345,
      "rmse_dy": 0.007838787510991096,
      "rmse_mean": 0.031179457902908325,
      "rotation_flip": 0.010476190596818924,
      "sparse_tokens": 14222.0,
      "step": 10414,
      "turn_loss": 0.30796441435813904,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4838784612525553,
      "grad_norm": 0.34273838996887207,
      "learning_rate": 4.33348940525018e-07,
      "loss": 0.0527,
      "mae_dtheta": 0.009161222726106644,
      "mae_dx": 0.001388202770613134,
      "mae_dy": 0.001980570377781987,
      "pose_mae_dtheta": 0.06209692731499672,
      "pose_mae_dx": 0.0189347080886364,
      "pose_mae_dy": 0.02517501637339592,
      "pose_rmse_dtheta": 0.12880533933639526,
      "pose_rmse_dx": 0.04578549787402153,
      "pose_rmse_dy": 0.05563100799918175,
      "pose_rmse_mean": 0.07674062252044678,
      "rmse_dtheta": 0.018548063933849335,
      "rmse_dx": 0.0042756833136081696,
      "rmse_dy": 0.003888993291184306,
      "rmse_mean": 0.008904246613383293,
      "rotation_flip": 0.0042553190141916275,
      "sparse_tokens": 32121.0,
      "step": 10415,
      "turn_loss": 0.07053478062152863,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.48392492101839807,
      "grad_norm": 0.35157468914985657,
      "learning_rate": 4.3281066646300605e-07,
      "loss": 0.0746,
      "mae_dtheta": 0.007543071638792753,
      "mae_dx": 0.0021604904904961586,
      "mae_dy": 0.0004840649198740721,
      "pose_mae_dtheta": 0.05390390753746033,
      "pose_mae_dx": 0.018331171944737434,
      "pose_mae_dy": 0.006101544015109539,
      "pose_rmse_dtheta": 0.20208896696567535,
      "pose_rmse_dx": 0.049664147198200226,
      "pose_rmse_dy": 0.015739260241389275,
      "pose_rmse_mean": 0.0891641303896904,
      "rmse_dtheta": 0.024603471159934998,
      "rmse_dx": 0.006414624862372875,
      "rmse_dy": 0.001441455795429647,
      "rmse_mean": 0.01081985142081976,
      "rotation_flip": 0.004310344811528921,
      "sparse_tokens": 32185.0,
      "step": 10416,
      "turn_loss": 0.06586650758981705,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.48397138078424085,
      "grad_norm": 0.6966516971588135,
      "learning_rate": 4.322727117869951e-07,
      "loss": 0.1905,
      "mae_dtheta": 0.03582971915602684,
      "mae_dx": 0.006973262410610914,
      "mae_dy": 0.002227931749075651,
      "pose_mae_dtheta": 0.2573336660861969,
      "pose_mae_dx": 0.061337217688560486,
      "pose_mae_dy": 0.026545362547039986,
      "pose_rmse_dtheta": 0.4210543930530548,
      "pose_rmse_dx": 0.14226239919662476,
      "pose_rmse_dy": 0.07294125109910965,
      "pose_rmse_mean": 0.212086021900177,
      "rmse_dtheta": 0.05332746356725693,
      "rmse_dx": 0.016015606001019478,
      "rmse_dy": 0.005962176714092493,
      "rmse_mean": 0.02510174922645092,
      "rotation_flip": 0.019543973729014397,
      "sparse_tokens": 13214.0,
      "step": 10417,
      "turn_loss": 0.2482152283191681,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4840178405500836,
      "grad_norm": 0.4899248778820038,
      "learning_rate": 4.3173507653460564e-07,
      "loss": 0.1428,
      "mae_dtheta": 0.007838062942028046,
      "mae_dx": 0.0014329253463074565,
      "mae_dy": 0.0013515782775357366,
      "pose_mae_dtheta": 0.05146558955311775,
      "pose_mae_dx": 0.016432756558060646,
      "pose_mae_dy": 0.01503705233335495,
      "pose_rmse_dtheta": 0.1583297997713089,
      "pose_rmse_dx": 0.04277276247739792,
      "pose_rmse_dy": 0.04595625028014183,
      "pose_rmse_mean": 0.08235293626785278,
      "rmse_dtheta": 0.021132564172148705,
      "rmse_dx": 0.0043360451236367226,
      "rmse_dy": 0.0036511037033051252,
      "rmse_mean": 0.009706571698188782,
      "rotation_flip": 0.007910655811429024,
      "sparse_tokens": 32169.0,
      "step": 10418,
      "turn_loss": 0.06228998303413391,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4840643003159264,
      "grad_norm": 0.4445360600948334,
      "learning_rate": 4.311977607434337e-07,
      "loss": 0.1145,
      "mae_dtheta": 0.013561884872615337,
      "mae_dx": 0.002676212228834629,
      "mae_dy": 0.004272018559277058,
      "pose_mae_dtheta": 0.09765707701444626,
      "pose_mae_dx": 0.034356556832790375,
      "pose_mae_dy": 0.033963486552238464,
      "pose_rmse_dtheta": 0.2402377724647522,
      "pose_rmse_dx": 0.08420894294977188,
      "pose_rmse_dy": 0.069329172372818,
      "pose_rmse_mean": 0.13125863671302795,
      "rmse_dtheta": 0.02695964090526104,
      "rmse_dx": 0.006869487464427948,
      "rmse_dy": 0.009015765972435474,
      "rmse_mean": 0.014281632378697395,
      "rotation_flip": 0.006630880758166313,
      "sparse_tokens": 32105.0,
      "step": 10419,
      "turn_loss": 0.12011104077100754,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4841107600817692,
      "grad_norm": 0.48274874687194824,
      "learning_rate": 4.306607644510552e-07,
      "loss": 0.1328,
      "mae_dtheta": 0.007250273134559393,
      "mae_dx": 0.0018279473297297955,
      "mae_dy": 0.0015122212935239077,
      "pose_mae_dtheta": 0.05365515872836113,
      "pose_mae_dx": 0.019423527643084526,
      "pose_mae_dy": 0.014622271992266178,
      "pose_rmse_dtheta": 0.19206683337688446,
      "pose_rmse_dx": 0.06240561604499817,
      "pose_rmse_dy": 0.041656192392110825,
      "pose_rmse_mean": 0.09870954602956772,
      "rmse_dtheta": 0.021211808547377586,
      "rmse_dx": 0.005807589273899794,
      "rmse_dy": 0.004757301416248083,
      "rmse_mean": 0.010592233389616013,
      "rotation_flip": 0.002207505516707897,
      "sparse_tokens": 32153.0,
      "step": 10420,
      "turn_loss": 0.058180540800094604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.48415721984761195,
      "grad_norm": 0.4938080310821533,
      "learning_rate": 4.3012408769502134e-07,
      "loss": 0.1058,
      "mae_dtheta": 0.00885904673486948,
      "mae_dx": 0.0016746213659644127,
      "mae_dy": 0.0018046709010377526,
      "pose_mae_dtheta": 0.056801121681928635,
      "pose_mae_dx": 0.01918615773320198,
      "pose_mae_dy": 0.021159425377845764,
      "pose_rmse_dtheta": 0.1417112946510315,
      "pose_rmse_dx": 0.0551929771900177,
      "pose_rmse_dy": 0.06645774096250534,
      "pose_rmse_mean": 0.08778734505176544,
      "rmse_dtheta": 0.02047448232769966,
      "rmse_dx": 0.0055207847617566586,
      "rmse_dy": 0.005725360009819269,
      "rmse_mean": 0.010573542676866055,
      "rotation_flip": 0.007844947278499603,
      "sparse_tokens": 32089.0,
      "step": 10421,
      "turn_loss": 0.07280992716550827,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.48420367961345473,
      "grad_norm": 0.3767355978488922,
      "learning_rate": 4.295877305128632e-07,
      "loss": 0.1241,
      "mae_dtheta": 0.008654394187033176,
      "mae_dx": 0.0014355520252138376,
      "mae_dy": 0.0021199097391217947,
      "pose_mae_dtheta": 0.05440298095345497,
      "pose_mae_dx": 0.017865151166915894,
      "pose_mae_dy": 0.024507073685526848,
      "pose_rmse_dtheta": 0.11264665424823761,
      "pose_rmse_dx": 0.042725820094347,
      "pose_rmse_dy": 0.05519171431660652,
      "pose_rmse_mean": 0.07018806040287018,
      "rmse_dtheta": 0.017967158928513527,
      "rmse_dx": 0.004381829872727394,
      "rmse_dy": 0.004987097345292568,
      "rmse_mean": 0.00911202933639288,
      "rotation_flip": 0.005168986041098833,
      "sparse_tokens": 32089.0,
      "step": 10422,
      "turn_loss": 0.08852442353963852,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.4842501393792975,
      "grad_norm": 0.49452871084213257,
      "learning_rate": 4.2905169294208846e-07,
      "loss": 0.1231,
      "mae_dtheta": 0.04389533773064613,
      "mae_dx": 0.01798582822084427,
      "mae_dy": 0.010486515238881111,
      "pose_mae_dtheta": 0.3797462582588196,
      "pose_mae_dx": 0.1351720541715622,
      "pose_mae_dy": 0.09615810960531235,
      "pose_rmse_dtheta": 0.5887249708175659,
      "pose_rmse_dx": 0.25790339708328247,
      "pose_rmse_dy": 0.17990978062152863,
      "pose_rmse_mean": 0.34217938780784607,
      "rmse_dtheta": 0.0600125677883625,
      "rmse_dx": 0.03051586262881756,
      "rmse_dy": 0.018682321533560753,
      "rmse_mean": 0.036403585225343704,
      "rotation_flip": 0.014846235513687134,
      "sparse_tokens": 15972.0,
      "step": 10423,
      "turn_loss": 0.4069480895996094,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4842965991451403,
      "grad_norm": 0.4143046736717224,
      "learning_rate": 4.285159750201817e-07,
      "loss": 0.1141,
      "mae_dtheta": 0.013130579143762589,
      "mae_dx": 0.0023769917897880077,
      "mae_dy": 0.0035907498095184565,
      "pose_mae_dtheta": 0.08099526911973953,
      "pose_mae_dx": 0.02375119738280773,
      "pose_mae_dy": 0.04069634526968002,
      "pose_rmse_dtheta": 0.17226751148700714,
      "pose_rmse_dx": 0.05884860083460808,
      "pose_rmse_dy": 0.10262554883956909,
      "pose_rmse_mean": 0.1112472265958786,
      "rmse_dtheta": 0.02614409662783146,
      "rmse_dx": 0.007333691697567701,
      "rmse_dy": 0.009530970826745033,
      "rmse_mean": 0.014336253516376019,
      "rotation_flip": 0.00922312866896391,
      "sparse_tokens": 32153.0,
      "step": 10424,
      "turn_loss": 0.14118050038814545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4843430589109831,
      "grad_norm": 0.4028605818748474,
      "learning_rate": 4.279805767846068e-07,
      "loss": 0.0907,
      "mae_dtheta": 0.010596104897558689,
      "mae_dx": 0.0015846833121031523,
      "mae_dy": 0.0034856500569730997,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4028606116771698,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.9929962158203,
      "model/head/act_norm_mean": 102.89193694760101,
      "model/head/act_norm_min": 45.688716888427734,
      "model/head/act_over_embed": 70.708302359882,
      "model/head/grad_frac": 0.10522139817476273,
      "model/head/grad_norm": 0.042389556765556335,
      "model/head/grad_zero_frac": 0.0001789412781363353,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.711001617739899,
      "model/head/update_ratio": 0.0007216196390800178,
      "model/head/weight_delta": 9.967439651489258,
      "model/head/weight_delta_rel": 0.17485842108726501,
      "model/head/weight_norm": 58.742244720458984,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228653609752655,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227979825511915,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42272740602493286,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905507319062554,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09637907892465591,
      "model/modality_embedder.encoders.pose/grad_norm": 0.038827333599328995,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5458315496575342,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012537108268588781,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1530606746673584,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1030203178524971,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969926834106445,
      "model/modality_embedder/grad_frac": 0.09637907892465591,
      "model/modality_embedder/grad_norm": 0.038827333599328995,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5458315496575342,
      "model/modality_embedder/update_ratio": 0.0012537108268588781,
      "model/modality_embedder/weight_delta": 3.1530606746673584,
      "model/modality_embedder/weight_delta_rel": 0.1030203178524971,
      "model/modality_embedder/weight_norm": 30.969926834106445,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.56256103515625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.945651956068623,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.08928108215332,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.768466844788524,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0609343945980072,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.024548066779971123,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008780020289123058,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7328085899353027,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09958519041538239,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.959009170532227,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.3849105834961,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.897804934263267,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.226217269897461,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.42279528560051,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06139485165476799,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.024733567610383034,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008308940450660884,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.464871644973755,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12002585828304291,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.767414093017578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.13799285888672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.706642316017316,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.054240226745605,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.66584526894427,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06367074698209763,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02565043605864048,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008344678208231926,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7532103061676025,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12602578103542328,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.738676071166992,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.70433044433594,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.479397146063814,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.117592811584473,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.88409898494443,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06462430208921432,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.026034586131572723,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008691928233020008,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.225226640701294,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1102229431271553,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.952600479125977,
      "model/normalizer/grad_frac": 0.2593725919723511,
      "model/normalizer/grad_norm": 0.10449099540710449,
      "model/normalizer/grad_zero_frac": 0.00025880071916617453,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0013284883461892605,
      "model/normalizer/weight_delta": 6.784654140472412,
      "model/normalizer/weight_delta_rel": 0.08738241344690323,
      "model/normalizer/weight_norm": 78.654052734375,
      "pose_mae_dtheta": 0.0772014781832695,
      "pose_mae_dx": 0.02245212160050869,
      "pose_mae_dy": 0.0349065437912941,
      "pose_rmse_dtheta": 0.21300014853477478,
      "pose_rmse_dx": 0.06208024546504021,
      "pose_rmse_dy": 0.11360366642475128,
      "pose_rmse_mean": 0.12956134974956512,
      "rmse_dtheta": 0.024242611601948738,
      "rmse_dx": 0.0046620904467999935,
      "rmse_dy": 0.008888971991837025,
      "rmse_mean": 0.012597891502082348,
      "rotation_flip": 0.0025547444820404053,
      "sparse_tokens": 32073.0,
      "step": 10425,
      "turn_loss": 0.09461579471826553,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4843895186768259,
      "grad_norm": 0.5833338499069214,
      "learning_rate": 4.274454982728032e-07,
      "loss": 0.1273,
      "mae_dtheta": 0.0070873405784368515,
      "mae_dx": 0.0014125294983386993,
      "mae_dy": 0.0016444619977846742,
      "pose_mae_dtheta": 0.048314355313777924,
      "pose_mae_dx": 0.01879621110856533,
      "pose_mae_dy": 0.020206088200211525,
      "pose_rmse_dtheta": 0.14370709657669067,
      "pose_rmse_dx": 0.060011837631464005,
      "pose_rmse_dy": 0.05874330550432205,
      "pose_rmse_mean": 0.08748741447925568,
      "rmse_dtheta": 0.018683040514588356,
      "rmse_dx": 0.004401542712002993,
      "rmse_dy": 0.004626462701708078,
      "rmse_mean": 0.009237015619874,
      "rotation_flip": 0.006160164251923561,
      "sparse_tokens": 32121.0,
      "step": 10426,
      "turn_loss": 0.07197768241167068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34063.0,
      "epoch": 0.48443597844266867,
      "grad_norm": 0.4176023006439209,
      "learning_rate": 4.2691073952219055e-07,
      "loss": 0.0972,
      "mae_dtheta": 0.03463973104953766,
      "mae_dx": 0.008600750006735325,
      "mae_dy": 0.004181911703199148,
      "pose_mae_dtheta": 0.264842689037323,
      "pose_mae_dx": 0.07401665300130844,
      "pose_mae_dy": 0.05024135485291481,
      "pose_rmse_dtheta": 0.5007824301719666,
      "pose_rmse_dx": 0.1794964075088501,
      "pose_rmse_dy": 0.11476658284664154,
      "pose_rmse_mean": 0.2650151550769806,
      "rmse_dtheta": 0.054478079080581665,
      "rmse_dx": 0.019723718985915184,
      "rmse_dy": 0.007427866570651531,
      "rmse_mean": 0.027209889143705368,
      "rotation_flip": 0.006588579621165991,
      "sparse_tokens": 25317.0,
      "step": 10427,
      "turn_loss": 0.2261611521244049,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.48448243820851145,
      "grad_norm": 0.3573561906814575,
      "learning_rate": 4.263763005701649e-07,
      "loss": 0.0827,
      "mae_dtheta": 0.008016451261937618,
      "mae_dx": 0.0010819967137649655,
      "mae_dy": 0.0016905382508412004,
      "pose_mae_dtheta": 0.0555892288684845,
      "pose_mae_dx": 0.015826692804694176,
      "pose_mae_dy": 0.02162635698914528,
      "pose_rmse_dtheta": 0.17209988832473755,
      "pose_rmse_dx": 0.045363638550043106,
      "pose_rmse_dy": 0.057299546897411346,
      "pose_rmse_mean": 0.09158769249916077,
      "rmse_dtheta": 0.020899947732686996,
      "rmse_dx": 0.003664847696200013,
      "rmse_dy": 0.0038007728289812803,
      "rmse_mean": 0.009455189108848572,
      "rotation_flip": 0.005299416836351156,
      "sparse_tokens": 32041.0,
      "step": 10428,
      "turn_loss": 0.058863937854766846,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.4845288979743542,
      "grad_norm": 0.44141870737075806,
      "learning_rate": 4.2584218145409916e-07,
      "loss": 0.1148,
      "mae_dtheta": 0.03491271659731865,
      "mae_dx": 0.009890045039355755,
      "mae_dy": 0.005222214385867119,
      "pose_mae_dtheta": 0.2488609403371811,
      "pose_mae_dx": 0.07662290334701538,
      "pose_mae_dy": 0.06574627757072449,
      "pose_rmse_dtheta": 0.4560116231441498,
      "pose_rmse_dx": 0.17715469002723694,
      "pose_rmse_dy": 0.17822861671447754,
      "pose_rmse_mean": 0.2704649865627289,
      "rmse_dtheta": 0.05586366727948189,
      "rmse_dx": 0.021807651966810226,
      "rmse_dy": 0.011104460805654526,
      "rmse_mean": 0.02959192916750908,
      "rotation_flip": 0.01634877361357212,
      "sparse_tokens": 13372.0,
      "step": 10429,
      "turn_loss": 0.21189220249652863,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.484575357740197,
      "grad_norm": 0.31031739711761475,
      "learning_rate": 4.253083822113452e-07,
      "loss": 0.0646,
      "mae_dtheta": 0.010212580673396587,
      "mae_dx": 0.0014305529184639454,
      "mae_dy": 0.001555552356876433,
      "pose_mae_dtheta": 0.07188581675291061,
      "pose_mae_dx": 0.0167810320854187,
      "pose_mae_dy": 0.021409986540675163,
      "pose_rmse_dtheta": 0.22185003757476807,
      "pose_rmse_dx": 0.043684251606464386,
      "pose_rmse_dy": 0.06469283252954483,
      "pose_rmse_mean": 0.1100757047533989,
      "rmse_dtheta": 0.027091359719634056,
      "rmse_dx": 0.0039672646671533585,
      "rmse_dy": 0.0036935955286026,
      "rmse_mean": 0.011584073305130005,
      "rotation_flip": 0.004017677623778582,
      "sparse_tokens": 32185.0,
      "step": 10430,
      "turn_loss": 0.07486928254365921,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.4846218175060398,
      "grad_norm": 0.5604678988456726,
      "learning_rate": 4.2477490287923026e-07,
      "loss": 0.1171,
      "mae_dtheta": 0.036089491099119186,
      "mae_dx": 0.014247837476432323,
      "mae_dy": 0.00440210523083806,
      "pose_mae_dtheta": 0.26456525921821594,
      "pose_mae_dx": 0.10212018340826035,
      "pose_mae_dy": 0.05264616757631302,
      "pose_rmse_dtheta": 0.47554537653923035,
      "pose_rmse_dx": 0.23711629211902618,
      "pose_rmse_dy": 0.13467125594615936,
      "pose_rmse_mean": 0.2824443280696869,
      "rmse_dtheta": 0.05585455894470215,
      "rmse_dx": 0.02753550186753273,
      "rmse_dy": 0.010453998111188412,
      "rmse_mean": 0.031281352043151855,
      "rotation_flip": 0.013474495150148869,
      "sparse_tokens": 16073.0,
      "step": 10431,
      "turn_loss": 0.2749742567539215,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.48466827727188255,
      "grad_norm": 0.6424469947814941,
      "learning_rate": 4.242417434950635e-07,
      "loss": 0.1469,
      "mae_dtheta": 0.022998780012130737,
      "mae_dx": 0.013719450682401657,
      "mae_dy": 0.006292255129665136,
      "pose_mae_dtheta": 0.1609577089548111,
      "pose_mae_dx": 0.11482515186071396,
      "pose_mae_dy": 0.0748395323753357,
      "pose_rmse_dtheta": 0.31389322876930237,
      "pose_rmse_dx": 0.2704613208770752,
      "pose_rmse_dy": 0.14719565212726593,
      "pose_rmse_mean": 0.24385005235671997,
      "rmse_dtheta": 0.038795024156570435,
      "rmse_dx": 0.029040375724434853,
      "rmse_dy": 0.012371773831546307,
      "rmse_mean": 0.02673572301864624,
      "rotation_flip": 0.006224066484719515,
      "sparse_tokens": 9295.0,
      "step": 10432,
      "turn_loss": 0.23455193638801575,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.48471473703772533,
      "grad_norm": 0.5056769251823425,
      "learning_rate": 4.237089040961262e-07,
      "loss": 0.1399,
      "mae_dtheta": 0.01473925355821848,
      "mae_dx": 0.0032936404459178448,
      "mae_dy": 0.004899977240711451,
      "pose_mae_dtheta": 0.10298414528369904,
      "pose_mae_dx": 0.04355628788471222,
      "pose_mae_dy": 0.041660938411951065,
      "pose_rmse_dtheta": 0.21135956048965454,
      "pose_rmse_dx": 0.10392234474420547,
      "pose_rmse_dy": 0.09350940585136414,
      "pose_rmse_mean": 0.13626377284526825,
      "rmse_dtheta": 0.02730177715420723,
      "rmse_dx": 0.007949314080178738,
      "rmse_dy": 0.01070996280759573,
      "rmse_mean": 0.015320352278649807,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 32153.0,
      "step": 10433,
      "turn_loss": 0.1433602273464203,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.4847611968035681,
      "grad_norm": 0.4705825746059418,
      "learning_rate": 4.2317638471968183e-07,
      "loss": 0.1177,
      "mae_dtheta": 0.017536213621497154,
      "mae_dx": 0.005842684768140316,
      "mae_dy": 0.0023042350076138973,
      "pose_mae_dtheta": 0.14734089374542236,
      "pose_mae_dx": 0.03875904902815819,
      "pose_mae_dy": 0.024757705628871918,
      "pose_rmse_dtheta": 0.2951468527317047,
      "pose_rmse_dx": 0.1076439619064331,
      "pose_rmse_dy": 0.06015080586075783,
      "pose_rmse_mean": 0.15431387722492218,
      "rmse_dtheta": 0.03252825513482094,
      "rmse_dx": 0.014828582294285297,
      "rmse_dy": 0.0047945287078619,
      "rmse_mean": 0.017383789643645287,
      "rotation_flip": 0.0045045046135783195,
      "sparse_tokens": 3266.0,
      "step": 10434,
      "turn_loss": 0.11471927165985107,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.4848076565694109,
      "grad_norm": 0.4235830008983612,
      "learning_rate": 4.2264418540297e-07,
      "loss": 0.1049,
      "mae_dtheta": 0.0291079580783844,
      "mae_dx": 0.008557501249015331,
      "mae_dy": 0.0036906334571540356,
      "pose_mae_dtheta": 0.21763314306735992,
      "pose_mae_dx": 0.07182683050632477,
      "pose_mae_dy": 0.0426667295396328,
      "pose_rmse_dtheta": 0.4143620729446411,
      "pose_rmse_dx": 0.18351051211357117,
      "pose_rmse_dy": 0.10540260374546051,
      "pose_rmse_mean": 0.23442506790161133,
      "rmse_dtheta": 0.04585705325007439,
      "rmse_dx": 0.020297041162848473,
      "rmse_dy": 0.007603316567838192,
      "rmse_mean": 0.024585803970694542,
      "rotation_flip": 0.010471204295754433,
      "sparse_tokens": 9006.0,
      "step": 10435,
      "turn_loss": 0.25695544481277466,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.48485411633525366,
      "grad_norm": 0.38653668761253357,
      "learning_rate": 4.221123061832066e-07,
      "loss": 0.0998,
      "mae_dtheta": 0.0366227887570858,
      "mae_dx": 0.013029424473643303,
      "mae_dy": 0.004416545387357473,
      "pose_mae_dtheta": 0.2998771667480469,
      "pose_mae_dx": 0.11442042887210846,
      "pose_mae_dy": 0.0646747574210167,
      "pose_rmse_dtheta": 0.5350214838981628,
      "pose_rmse_dx": 0.2448957860469818,
      "pose_rmse_dy": 0.15625855326652527,
      "pose_rmse_mean": 0.31205862760543823,
      "rmse_dtheta": 0.05654015392065048,
      "rmse_dx": 0.026279479265213013,
      "rmse_dy": 0.00911871250718832,
      "rmse_mean": 0.03064611554145813,
      "rotation_flip": 0.00657894741743803,
      "sparse_tokens": 15077.0,
      "step": 10436,
      "turn_loss": 0.29911765456199646,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.48490057610109644,
      "grad_norm": 0.38037872314453125,
      "learning_rate": 4.2158074709758746e-07,
      "loss": 0.113,
      "mae_dtheta": 0.008186111226677895,
      "mae_dx": 0.0011223424226045609,
      "mae_dy": 0.0017748067621141672,
      "pose_mae_dtheta": 0.05450757220387459,
      "pose_mae_dx": 0.017406785860657692,
      "pose_mae_dy": 0.025005506351590157,
      "pose_rmse_dtheta": 0.12135502696037292,
      "pose_rmse_dx": 0.04455465450882912,
      "pose_rmse_dy": 0.06556694954633713,
      "pose_rmse_mean": 0.07715888321399689,
      "rmse_dtheta": 0.018138112500309944,
      "rmse_dx": 0.003815470729023218,
      "rmse_dy": 0.004418625961989164,
      "rmse_mean": 0.008790737017989159,
      "rotation_flip": 0.00431880634278059,
      "sparse_tokens": 32073.0,
      "step": 10437,
      "turn_loss": 0.0589216873049736,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.4849470358669392,
      "grad_norm": 0.5624496936798096,
      "learning_rate": 4.2104950818328326e-07,
      "loss": 0.0768,
      "mae_dtheta": 0.030831389129161835,
      "mae_dx": 0.012936215847730637,
      "mae_dy": 0.006669677793979645,
      "pose_mae_dtheta": 0.21162545680999756,
      "pose_mae_dx": 0.11651986092329025,
      "pose_mae_dy": 0.06931217759847641,
      "pose_rmse_dtheta": 0.3495216965675354,
      "pose_rmse_dx": 0.22536979615688324,
      "pose_rmse_dy": 0.13390891253948212,
      "pose_rmse_mean": 0.2362668216228485,
      "rmse_dtheta": 0.04489031061530113,
      "rmse_dx": 0.024178925901651382,
      "rmse_dy": 0.010589191690087318,
      "rmse_mean": 0.02655280940234661,
      "rotation_flip": 0.008797653950750828,
      "sparse_tokens": 5558.0,
      "step": 10438,
      "turn_loss": 0.2713683843612671,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.484993495632782,
      "grad_norm": 0.49792057275772095,
      "learning_rate": 4.205185894774455e-07,
      "loss": 0.1346,
      "mae_dtheta": 0.03247224539518356,
      "mae_dx": 0.005873228423297405,
      "mae_dy": 0.005634857341647148,
      "pose_mae_dtheta": 0.2825579047203064,
      "pose_mae_dx": 0.053321026265621185,
      "pose_mae_dy": 0.04535047709941864,
      "pose_rmse_dtheta": 0.5355028510093689,
      "pose_rmse_dx": 0.1166323870420456,
      "pose_rmse_dy": 0.1201721727848053,
      "pose_rmse_mean": 0.25743579864501953,
      "rmse_dtheta": 0.05533500388264656,
      "rmse_dx": 0.012878245674073696,
      "rmse_dy": 0.01397227868437767,
      "rmse_mean": 0.027395173907279968,
      "rotation_flip": 0.008948545902967453,
      "sparse_tokens": 8363.0,
      "step": 10439,
      "turn_loss": 0.27668601274490356,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 13325.0,
      "epoch": 0.48503995539862477,
      "grad_norm": 0.3410920202732086,
      "learning_rate": 4.1998799101719944e-07,
      "loss": 0.0919,
      "mae_dtheta": 0.03557947278022766,
      "mae_dx": 0.014464130625128746,
      "mae_dy": 0.003925650380551815,
      "pose_mae_dtheta": 0.2666334807872772,
      "pose_mae_dx": 0.12008273601531982,
      "pose_mae_dy": 0.03525829687714577,
      "pose_rmse_dtheta": 0.4760991334915161,
      "pose_rmse_dx": 0.24843834340572357,
      "pose_rmse_dy": 0.08685136586427689,
      "pose_rmse_mean": 0.2704629600048065,
      "rmse_dtheta": 0.054667603224515915,
      "rmse_dx": 0.02662975713610649,
      "rmse_dy": 0.009490958414971828,
      "rmse_mean": 0.030262773856520653,
      "rotation_flip": 0.01296829991042614,
      "sparse_tokens": 10105.0,
      "step": 10440,
      "turn_loss": 0.2368832528591156,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.48508641516446754,
      "grad_norm": 0.3716224133968353,
      "learning_rate": 4.194577128396521e-07,
      "loss": 0.0955,
      "mae_dtheta": 0.008105948567390442,
      "mae_dx": 0.0021347145084291697,
      "mae_dy": 0.002355151576921344,
      "pose_mae_dtheta": 0.05170430243015289,
      "pose_mae_dx": 0.019920749589800835,
      "pose_mae_dy": 0.01857605390250683,
      "pose_rmse_dtheta": 0.1286180168390274,
      "pose_rmse_dx": 0.0574379600584507,
      "pose_rmse_dy": 0.04507596418261528,
      "pose_rmse_mean": 0.07704398036003113,
      "rmse_dtheta": 0.020960912108421326,
      "rmse_dx": 0.006451882421970367,
      "rmse_dy": 0.006658796686679125,
      "rmse_mean": 0.011357197538018227,
      "rotation_flip": 0.0021123785991221666,
      "sparse_tokens": 32137.0,
      "step": 10441,
      "turn_loss": 0.09386806190013885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4851328749303104,
      "grad_norm": 0.38208654522895813,
      "learning_rate": 4.18927754981886e-07,
      "loss": 0.0689,
      "mae_dtheta": 0.006894045043736696,
      "mae_dx": 0.0014503204729408026,
      "mae_dy": 0.0015753088518977165,
      "pose_mae_dtheta": 0.04779639467597008,
      "pose_mae_dx": 0.017568664625287056,
      "pose_mae_dy": 0.019794950261712074,
      "pose_rmse_dtheta": 0.1280907392501831,
      "pose_rmse_dx": 0.053685981780290604,
      "pose_rmse_dy": 0.0529501847922802,
      "pose_rmse_mean": 0.07824230194091797,
      "rmse_dtheta": 0.01848030462861061,
      "rmse_dx": 0.005137319210916758,
      "rmse_dy": 0.0043921759352087975,
      "rmse_mean": 0.009336600080132484,
      "rotation_flip": 0.0022818027064204216,
      "sparse_tokens": 32041.0,
      "step": 10442,
      "turn_loss": 0.06261581182479858,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.48517933469615315,
      "grad_norm": 0.42968079447746277,
      "learning_rate": 4.183981174809598e-07,
      "loss": 0.1129,
      "mae_dtheta": 0.0069602602161467075,
      "mae_dx": 0.001130122458562255,
      "mae_dy": 0.0015235893661156297,
      "pose_mae_dtheta": 0.048485320061445236,
      "pose_mae_dx": 0.013192519545555115,
      "pose_mae_dy": 0.020429708063602448,
      "pose_rmse_dtheta": 0.16087573766708374,
      "pose_rmse_dx": 0.04622739180922508,
      "pose_rmse_dy": 0.0599096454679966,
      "pose_rmse_mean": 0.0890042632818222,
      "rmse_dtheta": 0.01916542463004589,
      "rmse_dx": 0.004182229284197092,
      "rmse_dy": 0.004193337634205818,
      "rmse_mean": 0.00918033067137003,
      "rotation_flip": 0.0005910165491513908,
      "sparse_tokens": 32057.0,
      "step": 10443,
      "turn_loss": 0.04581623896956444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.48522579446199593,
      "grad_norm": 0.6841435432434082,
      "learning_rate": 4.1786880037391286e-07,
      "loss": 0.1541,
      "mae_dtheta": 0.021684227511286736,
      "mae_dx": 0.005092273000627756,
      "mae_dy": 0.0038814875297248363,
      "pose_mae_dtheta": 0.18046559393405914,
      "pose_mae_dx": 0.0419803112745285,
      "pose_mae_dy": 0.05982301011681557,
      "pose_rmse_dtheta": 0.31180328130722046,
      "pose_rmse_dx": 0.09685773402452469,
      "pose_rmse_dy": 0.12827681005001068,
      "pose_rmse_mean": 0.1789792776107788,
      "rmse_dtheta": 0.036880046129226685,
      "rmse_dx": 0.013697882182896137,
      "rmse_dy": 0.006836446933448315,
      "rmse_mean": 0.019138125702738762,
      "rotation_flip": 0.014492753893136978,
      "sparse_tokens": 11884.0,
      "step": 10444,
      "turn_loss": 0.1947402060031891,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 35688.0,
      "epoch": 0.4852722542278387,
      "grad_norm": 0.7161198258399963,
      "learning_rate": 4.1733980369775994e-07,
      "loss": 0.246,
      "mae_dtheta": 0.028208481147885323,
      "mae_dx": 0.00830345693975687,
      "mae_dy": 0.004734589718282223,
      "pose_mae_dtheta": 0.20469264686107635,
      "pose_mae_dx": 0.07058500498533249,
      "pose_mae_dy": 0.048386309295892715,
      "pose_rmse_dtheta": 0.3810872435569763,
      "pose_rmse_dx": 0.18514829874038696,
      "pose_rmse_dy": 0.14605921506881714,
      "pose_rmse_mean": 0.2374315857887268,
      "rmse_dtheta": 0.046498388051986694,
      "rmse_dx": 0.019412392750382423,
      "rmse_dy": 0.012332498095929623,
      "rmse_mean": 0.026081092655658722,
      "rotation_flip": 0.01241464912891388,
      "sparse_tokens": 26733.0,
      "step": 10445,
      "turn_loss": 0.2465604990720749,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4853187139936815,
      "grad_norm": 0.42839038372039795,
      "learning_rate": 4.168111274894937e-07,
      "loss": 0.104,
      "mae_dtheta": 0.010850496590137482,
      "mae_dx": 0.00199780217371881,
      "mae_dy": 0.003892334643751383,
      "pose_mae_dtheta": 0.07502524554729462,
      "pose_mae_dx": 0.030887439846992493,
      "pose_mae_dy": 0.036191992461681366,
      "pose_rmse_dtheta": 0.165801003575325,
      "pose_rmse_dx": 0.08619473874568939,
      "pose_rmse_dy": 0.08480270951986313,
      "pose_rmse_mean": 0.11226615309715271,
      "rmse_dtheta": 0.021886274218559265,
      "rmse_dx": 0.005533081013709307,
      "rmse_dy": 0.008468331769108772,
      "rmse_mean": 0.011962562799453735,
      "rotation_flip": 0.00455580884590745,
      "sparse_tokens": 32057.0,
      "step": 10446,
      "turn_loss": 0.09777352958917618,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.48536517375952426,
      "grad_norm": 0.5292282700538635,
      "learning_rate": 4.1628277178608677e-07,
      "loss": 0.1195,
      "mae_dtheta": 0.013883927837014198,
      "mae_dx": 0.002877725288271904,
      "mae_dy": 0.004704740829765797,
      "pose_mae_dtheta": 0.09793338924646378,
      "pose_mae_dx": 0.03779057413339615,
      "pose_mae_dy": 0.03902804106473923,
      "pose_rmse_dtheta": 0.2360285073518753,
      "pose_rmse_dx": 0.091923289000988,
      "pose_rmse_dy": 0.07810189574956894,
      "pose_rmse_mean": 0.1353512406349182,
      "rmse_dtheta": 0.02845887467265129,
      "rmse_dx": 0.006678625475615263,
      "rmse_dy": 0.00949159823358059,
      "rmse_mean": 0.014876365661621094,
      "rotation_flip": 0.005608709994703531,
      "sparse_tokens": 32121.0,
      "step": 10447,
      "turn_loss": 0.14526741206645966,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.48541163352536704,
      "grad_norm": 0.8036471605300903,
      "learning_rate": 4.157547366244846e-07,
      "loss": 0.2345,
      "mae_dtheta": 0.024975871667265892,
      "mae_dx": 0.005711573176085949,
      "mae_dy": 0.002348468406125903,
      "pose_mae_dtheta": 0.195059671998024,
      "pose_mae_dx": 0.05329199135303497,
      "pose_mae_dy": 0.027198094874620438,
      "pose_rmse_dtheta": 0.4047502279281616,
      "pose_rmse_dx": 0.11971264332532883,
      "pose_rmse_dy": 0.07010792195796967,
      "pose_rmse_mean": 0.19819027185440063,
      "rmse_dtheta": 0.044869229197502136,
      "rmse_dx": 0.013272681273519993,
      "rmse_dy": 0.0047891088761389256,
      "rmse_mean": 0.02097700536251068,
      "rotation_flip": 0.01272727269679308,
      "sparse_tokens": 10302.0,
      "step": 10448,
      "turn_loss": 0.14533787965774536,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.4854580932912098,
      "grad_norm": 0.5200866460800171,
      "learning_rate": 4.1522702204161493e-07,
      "loss": 0.1023,
      "mae_dtheta": 0.04011454060673714,
      "mae_dx": 0.013667342253029346,
      "mae_dy": 0.005707243457436562,
      "pose_mae_dtheta": 0.3093360960483551,
      "pose_mae_dx": 0.11373614519834518,
      "pose_mae_dy": 0.07450057566165924,
      "pose_rmse_dtheta": 0.5342279076576233,
      "pose_rmse_dx": 0.2211066633462906,
      "pose_rmse_dy": 0.17017319798469543,
      "pose_rmse_mean": 0.3085026144981384,
      "rmse_dtheta": 0.059074535965919495,
      "rmse_dx": 0.025876661762595177,
      "rmse_dy": 0.011101895943284035,
      "rmse_mean": 0.032017700374126434,
      "rotation_flip": 0.0141287287697196,
      "sparse_tokens": 19834.0,
      "step": 10449,
      "turn_loss": 0.29976165294647217,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4855045530570526,
      "grad_norm": 0.3223732113838196,
      "learning_rate": 4.146996280743798e-07,
      "loss": 0.0807,
      "mae_dtheta": 0.009706051088869572,
      "mae_dx": 0.0010204652789980173,
      "mae_dy": 0.0020127512980252504,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3223732113838196,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.291748046875,
      "model/head/act_norm_mean": 107.20304608585859,
      "model/head/act_norm_min": 66.94483947753906,
      "model/head/act_over_embed": 73.67093692093225,
      "model/head/grad_frac": 0.12079805880784988,
      "model/head/grad_norm": 0.03894205763936043,
      "model/head/grad_zero_frac": 0.00018496943812351674,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7104344223484849,
      "model/head/update_ratio": 0.0006629290292039514,
      "model/head/weight_delta": 9.96839714050293,
      "model/head/weight_delta_rel": 0.17487521469593048,
      "model/head/weight_norm": 58.74242401123047,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228760898113251,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227953349074272,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227387011051178,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.290548912420673,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11439169943332672,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03687682002782822,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5190139840182648,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011907306034117937,
      "model/modality_embedder.encoders.pose/weight_delta": 3.153764486312866,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1030433177947998,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969911575317383,
      "model/modality_embedder/grad_frac": 0.11439169943332672,
      "model/modality_embedder/grad_norm": 0.03687682002782822,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5190139840182648,
      "model/modality_embedder/update_ratio": 0.0011907306034117937,
      "model/modality_embedder/weight_delta": 3.153764486312866,
      "model/modality_embedder/weight_delta_rel": 0.1030433177947998,
      "model/modality_embedder/weight_norm": 30.969911575317383,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.53421020507812,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.314095819304153,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.126541137695312,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.021664917029774,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06028947979211807,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.019435713067650795,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0006951470859348774,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.73329758644104,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09960301220417023,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.959136962890625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.35061645507812,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.253617524450856,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.513654708862305,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.667313028747376,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.062114883214235306,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.020024174824357033,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0006726841093041003,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4654290676116943,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12004517018795013,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.767576217651367,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.1865005493164,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.021968193843193,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.41993236541748,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.882540164313593,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06523005664348602,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.021028421819210052,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000684097409248352,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.753901958465576,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1260489970445633,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.738929748535156,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.94883728027344,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.74652026214526,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.759496688842773,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.067668491161612,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06255331635475159,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.020165512338280678,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006732450565323234,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2258620262145996,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11024465411901474,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.952707290649414,
      "model/normalizer/grad_frac": 0.20935529470443726,
      "model/normalizer/grad_norm": 0.06749054044485092,
      "model/normalizer/grad_zero_frac": 0.00026825463282875717,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0008580656722187996,
      "model/normalizer/weight_delta": 6.785892486572266,
      "model/normalizer/weight_delta_rel": 0.08739836513996124,
      "model/normalizer/weight_norm": 78.65428161621094,
      "pose_mae_dtheta": 0.057486068457365036,
      "pose_mae_dx": 0.017271123826503754,
      "pose_mae_dy": 0.026612816378474236,
      "pose_rmse_dtheta": 0.1184295117855072,
      "pose_rmse_dx": 0.04283810034394264,
      "pose_rmse_dy": 0.06033150106668472,
      "pose_rmse_mean": 0.07386636734008789,
      "rmse_dtheta": 0.01921544037759304,
      "rmse_dx": 0.0027503774035722017,
      "rmse_dy": 0.004012042656540871,
      "rmse_mean": 0.008659287355840206,
      "rotation_flip": 0.002991772722452879,
      "sparse_tokens": 32073.0,
      "step": 10450,
      "turn_loss": 0.06833919137716293,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.48555101282289537,
      "grad_norm": 0.5262629389762878,
      "learning_rate": 4.1417255475966145e-07,
      "loss": 0.1305,
      "mae_dtheta": 0.03562581166625023,
      "mae_dx": 0.016773175448179245,
      "mae_dy": 0.004501312039792538,
      "pose_mae_dtheta": 0.3154735267162323,
      "pose_mae_dx": 0.1320270299911499,
      "pose_mae_dy": 0.05509795621037483,
      "pose_rmse_dtheta": 0.5917931199073792,
      "pose_rmse_dx": 0.2908546030521393,
      "pose_rmse_dy": 0.14996831119060516,
      "pose_rmse_mean": 0.3442053496837616,
      "rmse_dtheta": 0.055898960679769516,
      "rmse_dx": 0.031154900789260864,
      "rmse_dy": 0.0102003812789917,
      "rmse_mean": 0.032418083399534225,
      "rotation_flip": 0.011544011533260345,
      "sparse_tokens": 11290.0,
      "step": 10451,
      "turn_loss": 0.25703296065330505,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.48559747258873814,
      "grad_norm": 0.7370755672454834,
      "learning_rate": 4.1364580213431705e-07,
      "loss": 0.2072,
      "mae_dtheta": 0.04787011817097664,
      "mae_dx": 0.010403155349195004,
      "mae_dy": 0.007860288955271244,
      "pose_mae_dtheta": 0.35447266697883606,
      "pose_mae_dx": 0.07766509056091309,
      "pose_mae_dy": 0.0817468911409378,
      "pose_rmse_dtheta": 0.5622214078903198,
      "pose_rmse_dx": 0.1699482649564743,
      "pose_rmse_dy": 0.18281222879886627,
      "pose_rmse_mean": 0.30499398708343506,
      "rmse_dtheta": 0.0678442046046257,
      "rmse_dx": 0.021185439079999924,
      "rmse_dy": 0.016659917309880257,
      "rmse_mean": 0.03522985428571701,
      "rotation_flip": 0.005141388159245253,
      "sparse_tokens": 6620.0,
      "step": 10452,
      "turn_loss": 0.3426646292209625,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4856439323545809,
      "grad_norm": 0.608984649181366,
      "learning_rate": 4.131193702351827e-07,
      "loss": 0.1364,
      "mae_dtheta": 0.01046848390251398,
      "mae_dx": 0.0023279343731701374,
      "mae_dy": 0.0026294603012502193,
      "pose_mae_dtheta": 0.07169973105192184,
      "pose_mae_dx": 0.024532092735171318,
      "pose_mae_dy": 0.02947831153869629,
      "pose_rmse_dtheta": 0.16434185206890106,
      "pose_rmse_dx": 0.07397806644439697,
      "pose_rmse_dy": 0.07699704170227051,
      "pose_rmse_mean": 0.10510566085577011,
      "rmse_dtheta": 0.02256348356604576,
      "rmse_dx": 0.007540758233517408,
      "rmse_dy": 0.006400874815881252,
      "rmse_mean": 0.012168372981250286,
      "rotation_flip": 0.005861136130988598,
      "sparse_tokens": 32089.0,
      "step": 10453,
      "turn_loss": 0.09184300154447556,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.4856903921204237,
      "grad_norm": 0.9530775547027588,
      "learning_rate": 4.1259325909907446e-07,
      "loss": 0.2091,
      "mae_dtheta": 0.03039826825261116,
      "mae_dx": 0.007734906394034624,
      "mae_dy": 0.003342859447002411,
      "pose_mae_dtheta": 0.20532488822937012,
      "pose_mae_dx": 0.058261409401893616,
      "pose_mae_dy": 0.027819043025374413,
      "pose_rmse_dtheta": 0.4151463508605957,
      "pose_rmse_dx": 0.14767543971538544,
      "pose_rmse_dy": 0.05643904581665993,
      "pose_rmse_mean": 0.20642028748989105,
      "rmse_dtheta": 0.05086464807391167,
      "rmse_dx": 0.01778516173362732,
      "rmse_dy": 0.007402405142784119,
      "rmse_mean": 0.025350740179419518,
      "rotation_flip": 0.01567944325506687,
      "sparse_tokens": 9994.0,
      "step": 10454,
      "turn_loss": 0.23161007463932037,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4857368518862665,
      "grad_norm": 0.7756748199462891,
      "learning_rate": 4.120674687627807e-07,
      "loss": 0.1679,
      "mae_dtheta": 0.010926272720098495,
      "mae_dx": 0.00236451905220747,
      "mae_dy": 0.004486884921789169,
      "pose_mae_dtheta": 0.07901860028505325,
      "pose_mae_dx": 0.03238251432776451,
      "pose_mae_dy": 0.04471024498343468,
      "pose_rmse_dtheta": 0.20132513344287872,
      "pose_rmse_dx": 0.08512898534536362,
      "pose_rmse_dy": 0.12733200192451477,
      "pose_rmse_mean": 0.13792870938777924,
      "rmse_dtheta": 0.022362690418958664,
      "rmse_dx": 0.006778195966035128,
      "rmse_dy": 0.010391706600785255,
      "rmse_mean": 0.013177531771361828,
      "rotation_flip": 0.0049001132138073444,
      "sparse_tokens": 32041.0,
      "step": 10455,
      "turn_loss": 0.11775262653827667,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.48578331165210925,
      "grad_norm": 0.3936307430267334,
      "learning_rate": 4.11541999263072e-07,
      "loss": 0.1119,
      "mae_dtheta": 0.02930462546646595,
      "mae_dx": 0.01160565484315157,
      "mae_dy": 0.005130305420607328,
      "pose_mae_dtheta": 0.20359842479228973,
      "pose_mae_dx": 0.090306855738163,
      "pose_mae_dy": 0.04341268166899681,
      "pose_rmse_dtheta": 0.35279181599617004,
      "pose_rmse_dx": 0.24038361012935638,
      "pose_rmse_dy": 0.09819746017456055,
      "pose_rmse_mean": 0.2304576337337494,
      "rmse_dtheta": 0.04484955593943596,
      "rmse_dx": 0.02485046163201332,
      "rmse_dy": 0.009840363636612892,
      "rmse_mean": 0.026513461023569107,
      "rotation_flip": 0.02139037474989891,
      "sparse_tokens": 6039.0,
      "step": 10456,
      "turn_loss": 0.3006189465522766,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.485829771417952,
      "grad_norm": 0.49294513463974,
      "learning_rate": 4.110168506366935e-07,
      "loss": 0.0965,
      "mae_dtheta": 0.011608554050326347,
      "mae_dx": 0.0032093569170683622,
      "mae_dy": 0.0041221012361347675,
      "pose_mae_dtheta": 0.08359858393669128,
      "pose_mae_dx": 0.03986675664782524,
      "pose_mae_dy": 0.040357302874326706,
      "pose_rmse_dtheta": 0.1848328411579132,
      "pose_rmse_dx": 0.10535745322704315,
      "pose_rmse_dy": 0.08892615139484406,
      "pose_rmse_mean": 0.12637214362621307,
      "rmse_dtheta": 0.022652216255664825,
      "rmse_dx": 0.008787166327238083,
      "rmse_dy": 0.008226577192544937,
      "rmse_mean": 0.013221986591815948,
      "rotation_flip": 0.005457025952637196,
      "sparse_tokens": 32089.0,
      "step": 10457,
      "turn_loss": 0.12469640374183655,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.48587623118379486,
      "grad_norm": 0.5106070637702942,
      "learning_rate": 4.1049202292037017e-07,
      "loss": 0.1253,
      "mae_dtheta": 0.009738563559949398,
      "mae_dx": 0.0022837526630610228,
      "mae_dy": 0.002951517468318343,
      "pose_mae_dtheta": 0.06950446963310242,
      "pose_mae_dx": 0.024219272658228874,
      "pose_mae_dy": 0.030496517196297646,
      "pose_rmse_dtheta": 0.16900847852230072,
      "pose_rmse_dx": 0.06520020961761475,
      "pose_rmse_dy": 0.0860326737165451,
      "pose_rmse_mean": 0.10674712061882019,
      "rmse_dtheta": 0.02219187654554844,
      "rmse_dx": 0.007587463594973087,
      "rmse_dy": 0.0072931814938783646,
      "rmse_mean": 0.012357508763670921,
      "rotation_flip": 0.006386175751686096,
      "sparse_tokens": 32121.0,
      "step": 10458,
      "turn_loss": 0.08979492634534836,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.48592269094963764,
      "grad_norm": 0.5052399039268494,
      "learning_rate": 4.099675161508021e-07,
      "loss": 0.0846,
      "mae_dtheta": 0.02034737728536129,
      "mae_dx": 0.008873271755874157,
      "mae_dy": 0.0026836965698748827,
      "pose_mae_dtheta": 0.1635918766260147,
      "pose_mae_dx": 0.07994715124368668,
      "pose_mae_dy": 0.05203545466065407,
      "pose_rmse_dtheta": 0.3055581748485565,
      "pose_rmse_dx": 0.21147862076759338,
      "pose_rmse_dy": 0.1330081820487976,
      "pose_rmse_mean": 0.21668165922164917,
      "rmse_dtheta": 0.035197608172893524,
      "rmse_dx": 0.02170887216925621,
      "rmse_dy": 0.0051806229166686535,
      "rmse_mean": 0.020695701241493225,
      "rotation_flip": 0.0086805559694767,
      "sparse_tokens": 13912.0,
      "step": 10459,
      "turn_loss": 0.16286644339561462,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.4859691507154804,
      "grad_norm": 0.6790454983711243,
      "learning_rate": 4.0944333036467056e-07,
      "loss": 0.168,
      "mae_dtheta": 0.038161300122737885,
      "mae_dx": 0.010541394352912903,
      "mae_dy": 0.006013397593051195,
      "pose_mae_dtheta": 0.27624446153640747,
      "pose_mae_dx": 0.08002371340990067,
      "pose_mae_dy": 0.09311766177415848,
      "pose_rmse_dtheta": 0.5019257068634033,
      "pose_rmse_dx": 0.2107728272676468,
      "pose_rmse_dy": 0.16579347848892212,
      "pose_rmse_mean": 0.2928306758403778,
      "rmse_dtheta": 0.056138813495635986,
      "rmse_dx": 0.025379382073879242,
      "rmse_dy": 0.010555229149758816,
      "rmse_mean": 0.03069114312529564,
      "rotation_flip": 0.014634146355092525,
      "sparse_tokens": 4252.0,
      "step": 10460,
      "turn_loss": 0.23967982828617096,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4860156104813232,
      "grad_norm": 0.43052566051483154,
      "learning_rate": 4.089194655986306e-07,
      "loss": 0.0981,
      "mae_dtheta": 0.015098847448825836,
      "mae_dx": 0.002724036807194352,
      "mae_dy": 0.004252658225595951,
      "pose_mae_dtheta": 0.09707021713256836,
      "pose_mae_dx": 0.03413485363125801,
      "pose_mae_dy": 0.0399312898516655,
      "pose_rmse_dtheta": 0.22695201635360718,
      "pose_rmse_dx": 0.08536718785762787,
      "pose_rmse_dy": 0.08487265557050705,
      "pose_rmse_mean": 0.13239729404449463,
      "rmse_dtheta": 0.029911212623119354,
      "rmse_dx": 0.007516079116612673,
      "rmse_dy": 0.008951108902692795,
      "rmse_mean": 0.015459466725587845,
      "rotation_flip": 0.007096575107425451,
      "sparse_tokens": 32105.0,
      "step": 10461,
      "turn_loss": 0.15862660109996796,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.48606207024716597,
      "grad_norm": 1.4713929891586304,
      "learning_rate": 4.083959218893158e-07,
      "loss": 0.1447,
      "mae_dtheta": 0.03435881808400154,
      "mae_dx": 0.011905794031918049,
      "mae_dy": 0.005490879528224468,
      "pose_mae_dtheta": 0.26243913173675537,
      "pose_mae_dx": 0.10166433453559875,
      "pose_mae_dy": 0.057344596832990646,
      "pose_rmse_dtheta": 0.4549473524093628,
      "pose_rmse_dx": 0.2213945835828781,
      "pose_rmse_dy": 0.11059115827083588,
      "pose_rmse_mean": 0.26231104135513306,
      "rmse_dtheta": 0.0502031147480011,
      "rmse_dx": 0.023657461628317833,
      "rmse_dy": 0.009905733168125153,
      "rmse_mean": 0.02792210504412651,
      "rotation_flip": 0.009626955725252628,
      "sparse_tokens": 13903.0,
      "step": 10462,
      "turn_loss": 0.29902806878089905,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.48610853001300874,
      "grad_norm": 0.4113926291465759,
      "learning_rate": 4.078726992733395e-07,
      "loss": 0.1342,
      "mae_dtheta": 0.009567265398800373,
      "mae_dx": 0.0011611765949055552,
      "mae_dy": 0.002721469383686781,
      "pose_mae_dtheta": 0.05981975793838501,
      "pose_mae_dx": 0.02250518463551998,
      "pose_mae_dy": 0.02960234507918358,
      "pose_rmse_dtheta": 0.11805180460214615,
      "pose_rmse_dx": 0.06374536454677582,
      "pose_rmse_dy": 0.06477614492177963,
      "pose_rmse_mean": 0.0821911096572876,
      "rmse_dtheta": 0.017928287386894226,
      "rmse_dx": 0.0033439784310758114,
      "rmse_dy": 0.005787465255707502,
      "rmse_mean": 0.009019911289215088,
      "rotation_flip": 0.006417516153305769,
      "sparse_tokens": 32041.0,
      "step": 10463,
      "turn_loss": 0.07679492235183716,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.4861549897788515,
      "grad_norm": 0.5416526198387146,
      "learning_rate": 4.0734979778728923e-07,
      "loss": 0.1144,
      "mae_dtheta": 0.021446948871016502,
      "mae_dx": 0.00657873647287488,
      "mae_dy": 0.002649968955665827,
      "pose_mae_dtheta": 0.1727721095085144,
      "pose_mae_dx": 0.04921206831932068,
      "pose_mae_dy": 0.030063366517424583,
      "pose_rmse_dtheta": 0.3556061089038849,
      "pose_rmse_dx": 0.11703910678625107,
      "pose_rmse_dy": 0.08687233924865723,
      "pose_rmse_mean": 0.18650585412979126,
      "rmse_dtheta": 0.03906325250864029,
      "rmse_dx": 0.01548095140606165,
      "rmse_dy": 0.006037732120603323,
      "rmse_mean": 0.020193979144096375,
      "rotation_flip": 0.010452961549162865,
      "sparse_tokens": 11817.0,
      "step": 10464,
      "turn_loss": 0.1809864491224289,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.4862014495446943,
      "grad_norm": 0.4456896185874939,
      "learning_rate": 4.0682721746773346e-07,
      "loss": 0.1028,
      "mae_dtheta": 0.015348788350820541,
      "mae_dx": 0.0040019117295742035,
      "mae_dy": 0.0020111987832933664,
      "pose_mae_dtheta": 0.1033729538321495,
      "pose_mae_dx": 0.027817923575639725,
      "pose_mae_dy": 0.02575184777379036,
      "pose_rmse_dtheta": 0.23278386890888214,
      "pose_rmse_dx": 0.07948911190032959,
      "pose_rmse_dy": 0.07165457308292389,
      "pose_rmse_mean": 0.12797585129737854,
      "rmse_dtheta": 0.03132464364171028,
      "rmse_dx": 0.012067332863807678,
      "rmse_dy": 0.0055933622643351555,
      "rmse_mean": 0.016328446567058563,
      "rotation_flip": 0.005076142027974129,
      "sparse_tokens": 13723.0,
      "step": 10465,
      "turn_loss": 0.123321034014225,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.4862479093105371,
      "grad_norm": 0.46032434701919556,
      "learning_rate": 4.063049583512152e-07,
      "loss": 0.0958,
      "mae_dtheta": 0.044660888612270355,
      "mae_dx": 0.0073011755011975765,
      "mae_dy": 0.0027563637122511864,
      "pose_mae_dtheta": 0.39821964502334595,
      "pose_mae_dx": 0.058257777243852615,
      "pose_mae_dy": 0.023980120196938515,
      "pose_rmse_dtheta": 0.6463766098022461,
      "pose_rmse_dx": 0.15025724470615387,
      "pose_rmse_dy": 0.05602450668811798,
      "pose_rmse_mean": 0.2842194437980652,
      "rmse_dtheta": 0.0627388134598732,
      "rmse_dx": 0.017275579273700714,
      "rmse_dy": 0.005903406534343958,
      "rmse_mean": 0.02863926813006401,
      "rotation_flip": 0.009273570030927658,
      "sparse_tokens": 11156.0,
      "step": 10466,
      "turn_loss": 0.30496886372566223,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 36663.0,
      "epoch": 0.48629436907637985,
      "grad_norm": 0.6396304965019226,
      "learning_rate": 4.057830204742563e-07,
      "loss": 0.1622,
      "mae_dtheta": 0.03196164593100548,
      "mae_dx": 0.010058035142719746,
      "mae_dy": 0.0049178688786923885,
      "pose_mae_dtheta": 0.23852792382240295,
      "pose_mae_dx": 0.07240772992372513,
      "pose_mae_dy": 0.04921087995171547,
      "pose_rmse_dtheta": 0.41786089539527893,
      "pose_rmse_dx": 0.17611047625541687,
      "pose_rmse_dy": 0.13088250160217285,
      "pose_rmse_mean": 0.24161796271800995,
      "rmse_dtheta": 0.049514394253492355,
      "rmse_dx": 0.02128027379512787,
      "rmse_dy": 0.011484537273645401,
      "rmse_mean": 0.027426403015851974,
      "rotation_flip": 0.013715710490942001,
      "sparse_tokens": 27501.0,
      "step": 10467,
      "turn_loss": 0.2550724446773529,
      "turns": 113.0,
      "turns_per_sample": 113.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.48634082884222263,
      "grad_norm": 0.5544272065162659,
      "learning_rate": 4.0526140387335764e-07,
      "loss": 0.1342,
      "mae_dtheta": 0.0327279232442379,
      "mae_dx": 0.011804992333054543,
      "mae_dy": 0.004383194260299206,
      "pose_mae_dtheta": 0.23772630095481873,
      "pose_mae_dx": 0.0985836312174797,
      "pose_mae_dy": 0.06835469603538513,
      "pose_rmse_dtheta": 0.38629430532455444,
      "pose_rmse_dx": 0.19252680242061615,
      "pose_rmse_dy": 0.14981257915496826,
      "pose_rmse_mean": 0.24287790060043335,
      "rmse_dtheta": 0.048742953687906265,
      "rmse_dx": 0.02320963703095913,
      "rmse_dy": 0.008471796289086342,
      "rmse_mean": 0.026808127760887146,
      "rotation_flip": 0.013059701770544052,
      "sparse_tokens": 8907.0,
      "step": 10468,
      "turn_loss": 0.2359263300895691,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.4863872886080654,
      "grad_norm": 0.6692107915878296,
      "learning_rate": 4.0474010858499444e-07,
      "loss": 0.2421,
      "mae_dtheta": 0.022094836458563805,
      "mae_dx": 0.005578202195465565,
      "mae_dy": 0.003146213013678789,
      "pose_mae_dtheta": 0.18298955261707306,
      "pose_mae_dx": 0.03883103281259537,
      "pose_mae_dy": 0.042228564620018005,
      "pose_rmse_dtheta": 0.38516727089881897,
      "pose_rmse_dx": 0.10368027538061142,
      "pose_rmse_dy": 0.116659976541996,
      "pose_rmse_mean": 0.20183585584163666,
      "rmse_dtheta": 0.04122867435216904,
      "rmse_dx": 0.015715545043349266,
      "rmse_dy": 0.006727006286382675,
      "rmse_mean": 0.02122374437749386,
      "rotation_flip": 0.0053571430034935474,
      "sparse_tokens": 15683.0,
      "step": 10469,
      "turn_loss": 0.15123650431632996,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.4864337483739082,
      "grad_norm": 0.9022265076637268,
      "learning_rate": 4.042191346456226e-07,
      "loss": 0.142,
      "mae_dtheta": 0.040749017149209976,
      "mae_dx": 0.013451374135911465,
      "mae_dy": 0.0037251710891723633,
      "pose_mae_dtheta": 0.35022714734077454,
      "pose_mae_dx": 0.11988208442926407,
      "pose_mae_dy": 0.04393239691853523,
      "pose_rmse_dtheta": 0.5995734930038452,
      "pose_rmse_dx": 0.27197718620300293,
      "pose_rmse_dy": 0.09625472873449326,
      "pose_rmse_mean": 0.3226017951965332,
      "rmse_dtheta": 0.06110158562660217,
      "rmse_dx": 0.027440806850790977,
      "rmse_dy": 0.007139860186725855,
      "rmse_mean": 0.03189408779144287,
      "rotation_flip": 0.0033167495857924223,
      "sparse_tokens": 9650.0,
      "step": 10470,
      "turn_loss": 0.28446197509765625,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.48648020813975096,
      "grad_norm": 0.4530784487724304,
      "learning_rate": 4.036984820916723e-07,
      "loss": 0.0764,
      "mae_dtheta": 0.028720974922180176,
      "mae_dx": 0.0030266332905739546,
      "mae_dy": 0.0058809430338442326,
      "pose_mae_dtheta": 0.1995101422071457,
      "pose_mae_dx": 0.04414775222539902,
      "pose_mae_dy": 0.07388883829116821,
      "pose_rmse_dtheta": 0.39793121814727783,
      "pose_rmse_dx": 0.12371405959129333,
      "pose_rmse_dy": 0.16004198789596558,
      "pose_rmse_mean": 0.22722910344600677,
      "rmse_dtheta": 0.046827442944049835,
      "rmse_dx": 0.008749821223318577,
      "rmse_dy": 0.011040383018553257,
      "rmse_mean": 0.022205881774425507,
      "rotation_flip": 0.014563106931746006,
      "sparse_tokens": 6748.0,
      "step": 10471,
      "turn_loss": 0.21761244535446167,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.48652666790559373,
      "grad_norm": 0.6366927027702332,
      "learning_rate": 4.031781509595545e-07,
      "loss": 0.1373,
      "mae_dtheta": 0.010127952322363853,
      "mae_dx": 0.002002665540203452,
      "mae_dy": 0.003489207709208131,
      "pose_mae_dtheta": 0.06034153327345848,
      "pose_mae_dx": 0.02735981158912182,
      "pose_mae_dy": 0.028911489993333817,
      "pose_rmse_dtheta": 0.11260538548231125,
      "pose_rmse_dx": 0.06511224806308746,
      "pose_rmse_dy": 0.056616511195898056,
      "pose_rmse_mean": 0.07811138033866882,
      "rmse_dtheta": 0.01884101890027523,
      "rmse_dx": 0.005505129229277372,
      "rmse_dy": 0.006425357889384031,
      "rmse_mean": 0.010257169604301453,
      "rotation_flip": 0.0019960079807788134,
      "sparse_tokens": 32105.0,
      "step": 10472,
      "turn_loss": 0.10344555228948593,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4865731276714365,
      "grad_norm": 0.6991676688194275,
      "learning_rate": 4.0265814128565674e-07,
      "loss": 0.1864,
      "mae_dtheta": 0.010149720124900341,
      "mae_dx": 0.001854378147982061,
      "mae_dy": 0.0032548767048865557,
      "pose_mae_dtheta": 0.07321451604366302,
      "pose_mae_dx": 0.02415383793413639,
      "pose_mae_dy": 0.027061091735959053,
      "pose_rmse_dtheta": 0.18164195120334625,
      "pose_rmse_dx": 0.062143661081790924,
      "pose_rmse_dy": 0.05897330865263939,
      "pose_rmse_mean": 0.10091964900493622,
      "rmse_dtheta": 0.023280972614884377,
      "rmse_dx": 0.005008515901863575,
      "rmse_dy": 0.008907989598810673,
      "rmse_mean": 0.012399159371852875,
      "rotation_flip": 0.00369959301315248,
      "sparse_tokens": 32121.0,
      "step": 10473,
      "turn_loss": 0.10676310956478119,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4866195874372793,
      "grad_norm": 0.38467931747436523,
      "learning_rate": 4.0213845310634157e-07,
      "loss": 0.0813,
      "mae_dtheta": 0.00859162025153637,
      "mae_dx": 0.002020935993641615,
      "mae_dy": 0.00285154627636075,
      "pose_mae_dtheta": 0.0564221516251564,
      "pose_mae_dx": 0.029576491564512253,
      "pose_mae_dy": 0.024427497759461403,
      "pose_rmse_dtheta": 0.13745485246181488,
      "pose_rmse_dx": 0.07598090916872025,
      "pose_rmse_dy": 0.05691511183977127,
      "pose_rmse_mean": 0.0901169627904892,
      "rmse_dtheta": 0.019519107416272163,
      "rmse_dx": 0.004890585783869028,
      "rmse_dy": 0.006664713844656944,
      "rmse_mean": 0.010358136147260666,
      "rotation_flip": 0.004234026186168194,
      "sparse_tokens": 32121.0,
      "step": 10474,
      "turn_loss": 0.07672098278999329,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12959.0,
      "epoch": 0.4866660472031221,
      "grad_norm": 1.069398283958435,
      "learning_rate": 4.016190864579533e-07,
      "loss": 0.1739,
      "mae_dtheta": 0.02415432222187519,
      "mae_dx": 0.008016477338969707,
      "mae_dy": 0.002289667958393693,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999992251396179,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 151.29946899414062,
      "model/head/act_norm_mean": 122.3543212890625,
      "model/head/act_norm_min": 79.3362045288086,
      "model/head/act_over_embed": 84.08303508904729,
      "model/head/grad_frac": 0.10121230036020279,
      "model/head/grad_norm": 0.10121221840381622,
      "model/head/grad_zero_frac": 0.00020019848307128996,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7004150390625,
      "model/head/update_ratio": 0.001722979824990034,
      "model/head/weight_delta": 9.969388961791992,
      "model/head/weight_delta_rel": 0.1748926043510437,
      "model/head/weight_norm": 58.7425422668457,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42280006408691406,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42280006408691406,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42280006408691406,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29055216235709164,
      "model/modality_embedder.encoders.pose/grad_frac": 0.020225737243890762,
      "model/modality_embedder.encoders.pose/grad_norm": 0.02022572234272957,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0006530763930641115,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1538281440734863,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10304539650678635,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96991729736328,
      "model/modality_embedder/grad_frac": 0.020225737243890762,
      "model/modality_embedder/grad_norm": 0.02022572234272957,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0006530763930641115,
      "model/modality_embedder/weight_delta": 3.1538281440734863,
      "model/modality_embedder/weight_delta_rel": 0.10304539650678635,
      "model/modality_embedder/weight_norm": 30.96991729736328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.21363067626953,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.769176277281748,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.24986457824707,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.021609830429853,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07451998442411423,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.07451992481946945,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002665309701114893,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.733729839324951,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09961876273155212,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.959197998046875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.60260009765625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.531618923611113,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.552107810974121,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.54556755508791,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07491312175989151,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07491306215524673,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002516591688618064,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4659132957458496,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1200619488954544,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.767667770385742,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.04322052001953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.11963665674603,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.982911109924316,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.636868208554482,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.063400499522686,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06340044736862183,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000322788895573467,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0020625360775738955,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7546019554138184,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12607251107692719,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.739072799682617,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.65972900390625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.904737103174604,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.793197631835938,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.863605947713886,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05568721517920494,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05568717047572136,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.001859164098277688,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2264981269836426,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11026639491319656,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.952800750732422,
      "model/normalizer/grad_frac": 0.23700286448001862,
      "model/normalizer/grad_norm": 0.2370026856660843,
      "model/normalizer/grad_zero_frac": 0.000287162431050092,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0030132161919027567,
      "model/normalizer/weight_delta": 6.787067890167236,
      "model/normalizer/weight_delta_rel": 0.08741350471973419,
      "model/normalizer/weight_norm": 78.65438842773438,
      "pose_mae_dtheta": 0.19342036545276642,
      "pose_mae_dx": 0.053640902042388916,
      "pose_mae_dy": 0.03810201212763786,
      "pose_rmse_dtheta": 0.44356346130371094,
      "pose_rmse_dx": 0.14651180803775787,
      "pose_rmse_dy": 0.1129874512553215,
      "pose_rmse_mean": 0.23435424268245697,
      "rmse_dtheta": 0.04593896493315697,
      "rmse_dx": 0.02042694389820099,
      "rmse_dy": 0.005112552549690008,
      "rmse_mean": 0.023826155811548233,
      "rotation_flip": 0.02278481051325798,
      "sparse_tokens": 10421.0,
      "step": 10475,
      "turn_loss": 0.10201803594827652,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 14945.0,
      "epoch": 0.4867125069689649,
      "grad_norm": 0.36631402373313904,
      "learning_rate": 4.011000413768096e-07,
      "loss": 0.0823,
      "mae_dtheta": 0.03775838762521744,
      "mae_dx": 0.007739754859358072,
      "mae_dy": 0.0034032335970550776,
      "pose_mae_dtheta": 0.31050947308540344,
      "pose_mae_dx": 0.05853724479675293,
      "pose_mae_dy": 0.03163103386759758,
      "pose_rmse_dtheta": 0.49863821268081665,
      "pose_rmse_dx": 0.14513789117336273,
      "pose_rmse_dy": 0.0799793154001236,
      "pose_rmse_mean": 0.24125181138515472,
      "rmse_dtheta": 0.05437096580862999,
      "rmse_dx": 0.01955755613744259,
      "rmse_dy": 0.009571939706802368,
      "rmse_mean": 0.0278334878385067,
      "rotation_flip": 0.017879948019981384,
      "sparse_tokens": 11309.0,
      "step": 10476,
      "turn_loss": 0.23934447765350342,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 20064.0,
      "epoch": 0.4867589667348077,
      "grad_norm": 0.4775277376174927,
      "learning_rate": 4.005813178992091e-07,
      "loss": 0.1245,
      "mae_dtheta": 0.03770814836025238,
      "mae_dx": 0.007550341077148914,
      "mae_dy": 0.003786122892051935,
      "pose_mae_dtheta": 0.3098953664302826,
      "pose_mae_dx": 0.06459161639213562,
      "pose_mae_dy": 0.04724074527621269,
      "pose_rmse_dtheta": 0.529151439666748,
      "pose_rmse_dx": 0.18865330517292023,
      "pose_rmse_dy": 0.1371927261352539,
      "pose_rmse_mean": 0.28499916195869446,
      "rmse_dtheta": 0.05621061846613884,
      "rmse_dx": 0.019569024443626404,
      "rmse_dy": 0.00967844296246767,
      "rmse_mean": 0.028486032038927078,
      "rotation_flip": 0.007792207878082991,
      "sparse_tokens": 14192.0,
      "step": 10477,
      "turn_loss": 0.27430421113967896,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.48680542650065045,
      "grad_norm": 0.5005577206611633,
      "learning_rate": 4.0006291606142443e-07,
      "loss": 0.1036,
      "mae_dtheta": 0.02419065684080124,
      "mae_dx": 0.00891437754034996,
      "mae_dy": 0.003477849531918764,
      "pose_mae_dtheta": 0.20767660439014435,
      "pose_mae_dx": 0.06146427243947983,
      "pose_mae_dy": 0.04730591922998428,
      "pose_rmse_dtheta": 0.3542540967464447,
      "pose_rmse_dx": 0.13730338215827942,
      "pose_rmse_dy": 0.11305296421051025,
      "pose_rmse_mean": 0.20153681933879852,
      "rmse_dtheta": 0.03663262724876404,
      "rmse_dx": 0.01961475983262062,
      "rmse_dy": 0.006600253749638796,
      "rmse_mean": 0.020949214696884155,
      "rotation_flip": 0.004464285913854837,
      "sparse_tokens": 3994.0,
      "step": 10478,
      "turn_loss": 0.16893810033798218,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.48685188626649323,
      "grad_norm": 0.5438380837440491,
      "learning_rate": 3.995448358997095e-07,
      "loss": 0.1265,
      "mae_dtheta": 0.005989158526062965,
      "mae_dx": 0.0012050395598635077,
      "mae_dy": 0.0011444862466305494,
      "pose_mae_dtheta": 0.04220633953809738,
      "pose_mae_dx": 0.013929810374975204,
      "pose_mae_dy": 0.01442212238907814,
      "pose_rmse_dtheta": 0.1200563982129097,
      "pose_rmse_dx": 0.03622802346944809,
      "pose_rmse_dy": 0.04219037666916847,
      "pose_rmse_mean": 0.06615826487541199,
      "rmse_dtheta": 0.01668848656117916,
      "rmse_dx": 0.0031233299523591995,
      "rmse_dy": 0.003133139805868268,
      "rmse_mean": 0.0076483190059661865,
      "rotation_flip": 0.0020130849443376064,
      "sparse_tokens": 32137.0,
      "step": 10479,
      "turn_loss": 0.05222060903906822,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.486898346032336,
      "grad_norm": 0.3638644814491272,
      "learning_rate": 3.9902707745029413e-07,
      "loss": 0.0819,
      "mae_dtheta": 0.0063515217043459415,
      "mae_dx": 0.0012229416752234101,
      "mae_dy": 0.0016879115719348192,
      "pose_mae_dtheta": 0.04131106287240982,
      "pose_mae_dx": 0.013147802092134953,
      "pose_mae_dy": 0.01800963282585144,
      "pose_rmse_dtheta": 0.09205304086208344,
      "pose_rmse_dx": 0.035921890288591385,
      "pose_rmse_dy": 0.046956103295087814,
      "pose_rmse_mean": 0.05831034481525421,
      "rmse_dtheta": 0.015467419289052486,
      "rmse_dx": 0.003960445988923311,
      "rmse_dy": 0.004187554586678743,
      "rmse_mean": 0.007871806621551514,
      "rotation_flip": 0.0023288310039788485,
      "sparse_tokens": 32073.0,
      "step": 10480,
      "turn_loss": 0.05907122790813446,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.4869448057981788,
      "grad_norm": 0.5170733332633972,
      "learning_rate": 3.985096407493838e-07,
      "loss": 0.1187,
      "mae_dtheta": 0.030784847214818,
      "mae_dx": 0.012509890832006931,
      "mae_dy": 0.003712425706908107,
      "pose_mae_dtheta": 0.23625926673412323,
      "pose_mae_dx": 0.09189604222774506,
      "pose_mae_dy": 0.04444095492362976,
      "pose_rmse_dtheta": 0.4034421741962433,
      "pose_rmse_dx": 0.20751014351844788,
      "pose_rmse_dy": 0.1026875302195549,
      "pose_rmse_mean": 0.23787996172904968,
      "rmse_dtheta": 0.04778769984841347,
      "rmse_dx": 0.025193873792886734,
      "rmse_dy": 0.006776019465178251,
      "rmse_mean": 0.026585865765810013,
      "rotation_flip": 0.019914651289582253,
      "sparse_tokens": 12380.0,
      "step": 10481,
      "turn_loss": 0.24359777569770813,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.48699126556402156,
      "grad_norm": 0.46303072571754456,
      "learning_rate": 3.9799252583316515e-07,
      "loss": 0.1051,
      "mae_dtheta": 0.00657658651471138,
      "mae_dx": 0.0014804868260398507,
      "mae_dy": 0.001075979438610375,
      "pose_mae_dtheta": 0.04489355906844139,
      "pose_mae_dx": 0.011103772558271885,
      "pose_mae_dy": 0.011326516047120094,
      "pose_rmse_dtheta": 0.15346084535121918,
      "pose_rmse_dx": 0.03387950360774994,
      "pose_rmse_dy": 0.037812113761901855,
      "pose_rmse_mean": 0.07505082339048386,
      "rmse_dtheta": 0.021673504263162613,
      "rmse_dx": 0.005558233242481947,
      "rmse_dy": 0.004202018957585096,
      "rmse_mean": 0.01047791913151741,
      "rotation_flip": 0.0036591740790754557,
      "sparse_tokens": 32153.0,
      "step": 10482,
      "turn_loss": 0.05102936923503876,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.48703772532986433,
      "grad_norm": 0.34290239214897156,
      "learning_rate": 3.9747573273779816e-07,
      "loss": 0.0787,
      "mae_dtheta": 0.027654945850372314,
      "mae_dx": 0.01206399966031313,
      "mae_dy": 0.004103121347725391,
      "pose_mae_dtheta": 0.20424772799015045,
      "pose_mae_dx": 0.12524303793907166,
      "pose_mae_dy": 0.04476606100797653,
      "pose_rmse_dtheta": 0.4088893532752991,
      "pose_rmse_dx": 0.25469160079956055,
      "pose_rmse_dy": 0.09746906906366348,
      "pose_rmse_mean": 0.2536833584308624,
      "rmse_dtheta": 0.05011817440390587,
      "rmse_dx": 0.025085361674427986,
      "rmse_dy": 0.009880836121737957,
      "rmse_mean": 0.028361458331346512,
      "rotation_flip": 0.008333333767950535,
      "sparse_tokens": 6800.0,
      "step": 10483,
      "turn_loss": 0.2624073922634125,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.4870841850957071,
      "grad_norm": 0.5427136421203613,
      "learning_rate": 3.9695926149942497e-07,
      "loss": 0.1392,
      "mae_dtheta": 0.02880152128636837,
      "mae_dx": 0.007337571587413549,
      "mae_dy": 0.009684918448328972,
      "pose_mae_dtheta": 0.23012609779834747,
      "pose_mae_dx": 0.07248195260763168,
      "pose_mae_dy": 0.1490292102098465,
      "pose_rmse_dtheta": 0.4194936752319336,
      "pose_rmse_dx": 0.1548411250114441,
      "pose_rmse_dy": 0.31284472346305847,
      "pose_rmse_mean": 0.2957265079021454,
      "rmse_dtheta": 0.046058908104896545,
      "rmse_dx": 0.017757348716259003,
      "rmse_dy": 0.016661204397678375,
      "rmse_mean": 0.02682582102715969,
      "rotation_flip": 0.006410256493836641,
      "sparse_tokens": 8576.0,
      "step": 10484,
      "turn_loss": 0.3092898428440094,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4871306448615499,
      "grad_norm": 0.7738041281700134,
      "learning_rate": 3.9644311215415955e-07,
      "loss": 0.1208,
      "mae_dtheta": 0.008494128473103046,
      "mae_dx": 0.0018860313575714827,
      "mae_dy": 0.0020596329122781754,
      "pose_mae_dtheta": 0.06125040352344513,
      "pose_mae_dx": 0.016216231510043144,
      "pose_mae_dy": 0.025032635778188705,
      "pose_rmse_dtheta": 0.15644581615924835,
      "pose_rmse_dx": 0.0416969433426857,
      "pose_rmse_dy": 0.08279100060462952,
      "pose_rmse_mean": 0.09364458918571472,
      "rmse_dtheta": 0.01957840844988823,
      "rmse_dx": 0.0058524408377707005,
      "rmse_dy": 0.0070232064463198185,
      "rmse_mean": 0.010818018577992916,
      "rotation_flip": 0.004863813053816557,
      "sparse_tokens": 32105.0,
      "step": 10485,
      "turn_loss": 0.07857256382703781,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.48717710462739267,
      "grad_norm": 0.37785691022872925,
      "learning_rate": 3.959272847380985e-07,
      "loss": 0.1014,
      "mae_dtheta": 0.009925148449838161,
      "mae_dx": 0.0014931302284821868,
      "mae_dy": 0.002679478144273162,
      "pose_mae_dtheta": 0.0631929263472557,
      "pose_mae_dx": 0.02223462611436844,
      "pose_mae_dy": 0.027886511757969856,
      "pose_rmse_dtheta": 0.1872059553861618,
      "pose_rmse_dx": 0.05825942009687424,
      "pose_rmse_dy": 0.0606781467795372,
      "pose_rmse_mean": 0.10204784572124481,
      "rmse_dtheta": 0.022599278017878532,
      "rmse_dx": 0.003920014016330242,
      "rmse_dy": 0.005784270353615284,
      "rmse_mean": 0.010767853818833828,
      "rotation_flip": 0.005167958792299032,
      "sparse_tokens": 32105.0,
      "step": 10486,
      "turn_loss": 0.09400366991758347,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.48722356439323544,
      "grad_norm": 0.5945184826850891,
      "learning_rate": 3.9541177928731465e-07,
      "loss": 0.1248,
      "mae_dtheta": 0.03570347651839256,
      "mae_dx": 0.013409879058599472,
      "mae_dy": 0.006658188067376614,
      "pose_mae_dtheta": 0.24802511930465698,
      "pose_mae_dx": 0.11873655766248703,
      "pose_mae_dy": 0.08108682930469513,
      "pose_rmse_dtheta": 0.41827425360679626,
      "pose_rmse_dx": 0.2575302720069885,
      "pose_rmse_dy": 0.1709718108177185,
      "pose_rmse_mean": 0.2822587788105011,
      "rmse_dtheta": 0.05245666578412056,
      "rmse_dx": 0.025913605466485023,
      "rmse_dy": 0.01277208048850298,
      "rmse_mean": 0.03038078546524048,
      "rotation_flip": 0.014864864759147167,
      "sparse_tokens": 13889.0,
      "step": 10487,
      "turn_loss": 0.32230129837989807,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.4872700241590782,
      "grad_norm": 0.39456823468208313,
      "learning_rate": 3.9489659583785535e-07,
      "loss": 0.0944,
      "mae_dtheta": 0.028239047154784203,
      "mae_dx": 0.006633344572037458,
      "mae_dy": 0.0037421409506350756,
      "pose_mae_dtheta": 0.21327771246433258,
      "pose_mae_dx": 0.04410974308848381,
      "pose_mae_dy": 0.039286404848098755,
      "pose_rmse_dtheta": 0.3914092779159546,
      "pose_rmse_dx": 0.09667307138442993,
      "pose_rmse_dy": 0.09349937736988068,
      "pose_rmse_mean": 0.19386057555675507,
      "rmse_dtheta": 0.04406658932566643,
      "rmse_dx": 0.016294870525598526,
      "rmse_dy": 0.0072646052576601505,
      "rmse_mean": 0.022542022168636322,
      "rotation_flip": 0.022271715104579926,
      "sparse_tokens": 15165.0,
      "step": 10488,
      "turn_loss": 0.23350556194782257,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.487316483924921,
      "grad_norm": 0.5492713451385498,
      "learning_rate": 3.9438173442575e-07,
      "loss": 0.098,
      "mae_dtheta": 0.008328679017722607,
      "mae_dx": 0.0030215184669941664,
      "mae_dy": 0.0022030130494385958,
      "pose_mae_dtheta": 0.060337092727422714,
      "pose_mae_dx": 0.02874753624200821,
      "pose_mae_dy": 0.022871363908052444,
      "pose_rmse_dtheta": 0.16051547229290009,
      "pose_rmse_dx": 0.08588383346796036,
      "pose_rmse_dy": 0.06516464054584503,
      "pose_rmse_mean": 0.10385465621948242,
      "rmse_dtheta": 0.021199746057391167,
      "rmse_dx": 0.010003938339650631,
      "rmse_dy": 0.005548712331801653,
      "rmse_mean": 0.012250798754394054,
      "rotation_flip": 0.0036014404613524675,
      "sparse_tokens": 32169.0,
      "step": 10489,
      "turn_loss": 0.10550282895565033,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4873629436907638,
      "grad_norm": 0.5665126442909241,
      "learning_rate": 3.9386719508700046e-07,
      "loss": 0.1681,
      "mae_dtheta": 0.011794003657996655,
      "mae_dx": 0.0019742846488952637,
      "mae_dy": 0.0018357023363932967,
      "pose_mae_dtheta": 0.08846854418516159,
      "pose_mae_dx": 0.015314897522330284,
      "pose_mae_dy": 0.02031446062028408,
      "pose_rmse_dtheta": 0.301532119512558,
      "pose_rmse_dx": 0.035970788449048996,
      "pose_rmse_dy": 0.04855254665017128,
      "pose_rmse_mean": 0.1286851465702057,
      "rmse_dtheta": 0.031031157821416855,
      "rmse_dx": 0.008072569034993649,
      "rmse_dy": 0.005194126628339291,
      "rmse_mean": 0.014765951782464981,
      "rotation_flip": 0.004118616227060556,
      "sparse_tokens": 32137.0,
      "step": 10490,
      "turn_loss": 0.09588176757097244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4874094034566066,
      "grad_norm": 0.5874149203300476,
      "learning_rate": 3.9335297785759064e-07,
      "loss": 0.1278,
      "mae_dtheta": 0.008579096756875515,
      "mae_dx": 0.0009290603338740766,
      "mae_dy": 0.002017966704443097,
      "pose_mae_dtheta": 0.05902259051799774,
      "pose_mae_dx": 0.015647443011403084,
      "pose_mae_dy": 0.0283601563423872,
      "pose_rmse_dtheta": 0.13608403503894806,
      "pose_rmse_dx": 0.04572390019893646,
      "pose_rmse_dy": 0.08110105246305466,
      "pose_rmse_mean": 0.08763633668422699,
      "rmse_dtheta": 0.018055127933621407,
      "rmse_dx": 0.0029336935840547085,
      "rmse_dy": 0.00459615932777524,
      "rmse_mean": 0.008528327569365501,
      "rotation_flip": 0.004926108289510012,
      "sparse_tokens": 32057.0,
      "step": 10491,
      "turn_loss": 0.06503112614154816,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4874558632224494,
      "grad_norm": 0.3080955743789673,
      "learning_rate": 3.928390827734807e-07,
      "loss": 0.0708,
      "mae_dtheta": 0.008766715414822102,
      "mae_dx": 0.0015466094482690096,
      "mae_dy": 0.0021103876642882824,
      "pose_mae_dtheta": 0.05803883820772171,
      "pose_mae_dx": 0.018505524843931198,
      "pose_mae_dy": 0.02204713597893715,
      "pose_rmse_dtheta": 0.1379987597465515,
      "pose_rmse_dx": 0.05479746311903,
      "pose_rmse_dy": 0.047694623470306396,
      "pose_rmse_mean": 0.0801636204123497,
      "rmse_dtheta": 0.019852686673402786,
      "rmse_dx": 0.004857319872826338,
      "rmse_dy": 0.005212769843637943,
      "rmse_mean": 0.009974258951842785,
      "rotation_flip": 0.0038087177090346813,
      "sparse_tokens": 32089.0,
      "step": 10492,
      "turn_loss": 0.07581670582294464,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 39466.0,
      "epoch": 0.48750232298829216,
      "grad_norm": 0.627745509147644,
      "learning_rate": 3.9232550987060527e-07,
      "loss": 0.1704,
      "mae_dtheta": 0.03183729946613312,
      "mae_dx": 0.012443303130567074,
      "mae_dy": 0.004187107551842928,
      "pose_mae_dtheta": 0.25360721349716187,
      "pose_mae_dx": 0.09848874062299728,
      "pose_mae_dy": 0.05836329236626625,
      "pose_rmse_dtheta": 0.44902709126472473,
      "pose_rmse_dx": 0.21642173826694489,
      "pose_rmse_dy": 0.13429048657417297,
      "pose_rmse_mean": 0.266579806804657,
      "rmse_dtheta": 0.04860938340425491,
      "rmse_dx": 0.024958156049251556,
      "rmse_dy": 0.007748785894364119,
      "rmse_mean": 0.027105441316962242,
      "rotation_flip": 0.008891213685274124,
      "sparse_tokens": 29866.0,
      "step": 10493,
      "turn_loss": 0.25081679224967957,
      "turns": 122.0,
      "turns_per_sample": 122.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.48754878275413494,
      "grad_norm": 0.5351352691650391,
      "learning_rate": 3.918122591848811e-07,
      "loss": 0.1402,
      "mae_dtheta": 0.02672368846833706,
      "mae_dx": 0.009429645724594593,
      "mae_dy": 0.00512378104031086,
      "pose_mae_dtheta": 0.17766384780406952,
      "pose_mae_dx": 0.08445308357477188,
      "pose_mae_dy": 0.06073666736483574,
      "pose_rmse_dtheta": 0.3289802372455597,
      "pose_rmse_dx": 0.21841832995414734,
      "pose_rmse_dy": 0.1367955207824707,
      "pose_rmse_mean": 0.22806470096111298,
      "rmse_dtheta": 0.04356960207223892,
      "rmse_dx": 0.022117773070931435,
      "rmse_dy": 0.01102292351424694,
      "rmse_mean": 0.02557010017335415,
      "rotation_flip": 0.011594203300774097,
      "sparse_tokens": 12709.0,
      "step": 10494,
      "turn_loss": 0.26007506251335144,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4875952425199777,
      "grad_norm": 0.3450080454349518,
      "learning_rate": 3.9129933075219837e-07,
      "loss": 0.0754,
      "mae_dtheta": 0.009597525000572205,
      "mae_dx": 0.0021183055359870195,
      "mae_dy": 0.0031615071929991245,
      "pose_mae_dtheta": 0.06292600929737091,
      "pose_mae_dx": 0.027072453871369362,
      "pose_mae_dy": 0.029407953843474388,
      "pose_rmse_dtheta": 0.14731350541114807,
      "pose_rmse_dx": 0.09356161206960678,
      "pose_rmse_dy": 0.08524568378925323,
      "pose_rmse_mean": 0.10870693624019623,
      "rmse_dtheta": 0.022281862795352936,
      "rmse_dx": 0.007534109987318516,
      "rmse_dy": 0.009390939958393574,
      "rmse_mean": 0.013068970292806625,
      "rotation_flip": 0.0044606649316847324,
      "sparse_tokens": 32073.0,
      "step": 10495,
      "turn_loss": 0.09158706665039062,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.4876417022858205,
      "grad_norm": 0.5987012982368469,
      "learning_rate": 3.9078672460842736e-07,
      "loss": 0.1702,
      "mae_dtheta": 0.030443936586380005,
      "mae_dx": 0.008101283572614193,
      "mae_dy": 0.0040875147096812725,
      "pose_mae_dtheta": 0.2459682673215866,
      "pose_mae_dx": 0.07015740871429443,
      "pose_mae_dy": 0.05839163437485695,
      "pose_rmse_dtheta": 0.4345897436141968,
      "pose_rmse_dx": 0.16293518245220184,
      "pose_rmse_dy": 0.14577437937259674,
      "pose_rmse_mean": 0.2477664351463318,
      "rmse_dtheta": 0.047649163752794266,
      "rmse_dx": 0.01839848794043064,
      "rmse_dy": 0.008687815628945827,
      "rmse_mean": 0.024911824613809586,
      "rotation_flip": 0.009017132222652435,
      "sparse_tokens": 18031.0,
      "step": 10496,
      "turn_loss": 0.22279798984527588,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.48768816205166327,
      "grad_norm": 0.4812431335449219,
      "learning_rate": 3.9027444078941435e-07,
      "loss": 0.1272,
      "mae_dtheta": 0.009631495922803879,
      "mae_dx": 0.0016315412940457463,
      "mae_dy": 0.002071389462798834,
      "pose_mae_dtheta": 0.06761545687913895,
      "pose_mae_dx": 0.01980908401310444,
      "pose_mae_dy": 0.026228727772831917,
      "pose_rmse_dtheta": 0.17982320487499237,
      "pose_rmse_dx": 0.049582332372665405,
      "pose_rmse_dy": 0.06710958480834961,
      "pose_rmse_mean": 0.09883837401866913,
      "rmse_dtheta": 0.022250398993492126,
      "rmse_dx": 0.005539020523428917,
      "rmse_dy": 0.004589317832142115,
      "rmse_mean": 0.010792912915349007,
      "rotation_flip": 0.0020120723638683558,
      "sparse_tokens": 32057.0,
      "step": 10497,
      "turn_loss": 0.0758325532078743,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.48773462181750604,
      "grad_norm": 0.33654746413230896,
      "learning_rate": 3.8976247933098454e-07,
      "loss": 0.0687,
      "mae_dtheta": 0.013330573216080666,
      "mae_dx": 0.0017163369338959455,
      "mae_dy": 0.003020260250195861,
      "pose_mae_dtheta": 0.07615131884813309,
      "pose_mae_dx": 0.02612016722559929,
      "pose_mae_dy": 0.03393217548727989,
      "pose_rmse_dtheta": 0.1647355705499649,
      "pose_rmse_dx": 0.059194665402173996,
      "pose_rmse_dy": 0.07284168899059296,
      "pose_rmse_mean": 0.09892398118972778,
      "rmse_dtheta": 0.025661686435341835,
      "rmse_dx": 0.004553665407001972,
      "rmse_dy": 0.0060688345693051815,
      "rmse_mean": 0.012094728648662567,
      "rotation_flip": 0.00856836885213852,
      "sparse_tokens": 32057.0,
      "step": 10498,
      "turn_loss": 0.12009879946708679,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.4877810815833488,
      "grad_norm": 1.0494695901870728,
      "learning_rate": 3.892508402689388e-07,
      "loss": 0.2127,
      "mae_dtheta": 0.029789740219712257,
      "mae_dx": 0.01235006283968687,
      "mae_dy": 0.0037282458506524563,
      "pose_mae_dtheta": 0.21773502230644226,
      "pose_mae_dx": 0.07566460222005844,
      "pose_mae_dy": 0.05131286010146141,
      "pose_rmse_dtheta": 0.3656032979488373,
      "pose_rmse_dx": 0.20211878418922424,
      "pose_rmse_dy": 0.13065341114997864,
      "pose_rmse_mean": 0.23279182612895966,
      "rmse_dtheta": 0.04445965588092804,
      "rmse_dx": 0.026023633778095245,
      "rmse_dy": 0.007791719399392605,
      "rmse_mean": 0.026091670617461205,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 8314.0,
      "step": 10499,
      "turn_loss": 0.25373420119285583,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.4878275413491916,
      "grad_norm": 0.6087976694107056,
      "learning_rate": 3.8873952363905564e-07,
      "loss": 0.1114,
      "mae_dtheta": 0.038204871118068695,
      "mae_dx": 0.013352814130485058,
      "mae_dy": 0.00805503036826849,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6087974905967712,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 149.59213256835938,
      "model/head/act_norm_mean": 107.04972330729167,
      "model/head/act_norm_min": 73.61166381835938,
      "model/head/act_over_embed": 73.5655720720706,
      "model/head/grad_frac": 0.10918174684047699,
      "model/head/grad_norm": 0.06646957248449326,
      "model/head/grad_zero_frac": 0.00015895316028036177,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6979166666666666,
      "model/head/update_ratio": 0.001131538301706314,
      "model/head/weight_delta": 9.970155715942383,
      "model/head/weight_delta_rel": 0.17490606009960175,
      "model/head/weight_norm": 58.7426643371582,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4227991998195648,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4227991998195648,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227991998195648,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905515684244778,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09236595034599304,
      "model/modality_embedder.encoders.pose/grad_norm": 0.056232158094644547,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001815703115426004,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1540422439575195,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10305239260196686,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969907760620117,
      "model/modality_embedder/grad_frac": 0.09236595034599304,
      "model/modality_embedder/grad_norm": 0.056232158094644547,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.001815703115426004,
      "model/modality_embedder/weight_delta": 3.1540422439575195,
      "model/modality_embedder/weight_delta_rel": 0.10305239260196686,
      "model/modality_embedder/weight_norm": 30.969907760620117,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 76.88504028320312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.397637353552533,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.153071403503418,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.079075441493426,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05649673938751221,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03439507260918617,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012301818933337927,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7340927124023438,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09963198751211166,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.959339141845703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.21729278564453,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.171101426681783,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.609780311584473,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.61060719383259,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06835269927978516,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04161295294761658,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013979163486510515,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.466407537460327,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12007906287908554,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.767841339111328,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.68440246582031,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.764990197467878,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.049662590026855,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.705942479338567,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08014755696058273,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04879363253712654,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001587339211255312,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7552106380462646,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12609294056892395,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.739259719848633,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 80.24332427978516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.66152033730159,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.055865287780762,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.009255747027208,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08472192287445068,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.051578495651483536,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017219864530488849,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2271220684051514,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11028771847486496,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.952903747558594,
      "model/normalizer/grad_frac": 0.29339659214019775,
      "model/normalizer/grad_norm": 0.1786191165447235,
      "model/normalizer/grad_zero_frac": 0.00019616857753135264,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0022709318436682224,
      "model/normalizer/weight_delta": 6.788146495819092,
      "model/normalizer/weight_delta_rel": 0.08742740005254745,
      "model/normalizer/weight_norm": 78.65454864501953,
      "pose_mae_dtheta": 0.29386770725250244,
      "pose_mae_dx": 0.11059129983186722,
      "pose_mae_dy": 0.08564110845327377,
      "pose_rmse_dtheta": 0.5004851222038269,
      "pose_rmse_dx": 0.24507306516170502,
      "pose_rmse_dy": 0.17845116555690765,
      "pose_rmse_mean": 0.30800312757492065,
      "rmse_dtheta": 0.05510085076093674,
      "rmse_dx": 0.02625482901930809,
      "rmse_dy": 0.016150975599884987,
      "rmse_mean": 0.03250221908092499,
      "rotation_flip": 0.013996889814734459,
      "sparse_tokens": 11489.0,
      "step": 10500,
      "turn_loss": 0.32935312390327454,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4878740011150344,
      "grad_norm": 0.4320955276489258,
      "learning_rate": 3.882285294770938e-07,
      "loss": 0.1079,
      "mae_dtheta": 0.010674702934920788,
      "mae_dx": 0.002179498318582773,
      "mae_dy": 0.003806659020483494,
      "pose_mae_dtheta": 0.07100478559732437,
      "pose_mae_dx": 0.03370625898241997,
      "pose_mae_dy": 0.03321896493434906,
      "pose_rmse_dtheta": 0.17057815194129944,
      "pose_rmse_dx": 0.08250360190868378,
      "pose_rmse_dy": 0.06815265864133835,
      "pose_rmse_mean": 0.10707813501358032,
      "rmse_dtheta": 0.02194991707801819,
      "rmse_dx": 0.005680111702531576,
      "rmse_dy": 0.008034956641495228,
      "rmse_mean": 0.011888328939676285,
      "rotation_flip": 0.0032608695328235626,
      "sparse_tokens": 32073.0,
      "step": 10501,
      "turn_loss": 0.10003750771284103,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.48792046088087715,
      "grad_norm": 0.5410391092300415,
      "learning_rate": 3.8771785781878513e-07,
      "loss": 0.1367,
      "mae_dtheta": 0.008586138486862183,
      "mae_dx": 0.0012281613890081644,
      "mae_dy": 0.002052346942946315,
      "pose_mae_dtheta": 0.05637504160404205,
      "pose_mae_dx": 0.017310822382569313,
      "pose_mae_dy": 0.023388519883155823,
      "pose_rmse_dtheta": 0.15959344804286957,
      "pose_rmse_dx": 0.04121368005871773,
      "pose_rmse_dy": 0.04600260406732559,
      "pose_rmse_mean": 0.08226990699768066,
      "rmse_dtheta": 0.019966715946793556,
      "rmse_dx": 0.003319656243547797,
      "rmse_dy": 0.004173231311142445,
      "rmse_mean": 0.00915320124477148,
      "rotation_flip": 0.004056047182530165,
      "sparse_tokens": 32089.0,
      "step": 10502,
      "turn_loss": 0.0711963027715683,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.4879669206467199,
      "grad_norm": 0.7234750986099243,
      "learning_rate": 3.8720750869984334e-07,
      "loss": 0.099,
      "mae_dtheta": 0.03690978139638901,
      "mae_dx": 0.010340634733438492,
      "mae_dy": 0.005803810432553291,
      "pose_mae_dtheta": 0.3090384006500244,
      "pose_mae_dx": 0.0928686112165451,
      "pose_mae_dy": 0.07614357024431229,
      "pose_rmse_dtheta": 0.5387099385261536,
      "pose_rmse_dx": 0.19551870226860046,
      "pose_rmse_dy": 0.21327079832553864,
      "pose_rmse_mean": 0.3158331513404846,
      "rmse_dtheta": 0.05588631331920624,
      "rmse_dx": 0.021263357251882553,
      "rmse_dy": 0.011399890296161175,
      "rmse_mean": 0.029516521841287613,
      "rotation_flip": 0.010948904789984226,
      "sparse_tokens": 8647.0,
      "step": 10503,
      "turn_loss": 0.22783176600933075,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4880133804125627,
      "grad_norm": 0.39049169421195984,
      "learning_rate": 3.866974821559555e-07,
      "loss": 0.0946,
      "mae_dtheta": 0.008442007936537266,
      "mae_dx": 0.0013909798581153154,
      "mae_dy": 0.0014743492938578129,
      "pose_mae_dtheta": 0.056631509214639664,
      "pose_mae_dx": 0.014992601238191128,
      "pose_mae_dy": 0.01836383529007435,
      "pose_rmse_dtheta": 0.1641959249973297,
      "pose_rmse_dx": 0.05044182389974594,
      "pose_rmse_dy": 0.0452241487801075,
      "pose_rmse_mean": 0.08662064373493195,
      "rmse_dtheta": 0.022779010236263275,
      "rmse_dx": 0.004415175877511501,
      "rmse_dy": 0.0038901972584426403,
      "rmse_mean": 0.010361461900174618,
      "rotation_flip": 0.002138579962775111,
      "sparse_tokens": 32137.0,
      "step": 10504,
      "turn_loss": 0.060926374047994614,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.4880598401784055,
      "grad_norm": 0.48975902795791626,
      "learning_rate": 3.8618777822278854e-07,
      "loss": 0.1491,
      "mae_dtheta": 0.037892673164606094,
      "mae_dx": 0.010357074439525604,
      "mae_dy": 0.007301772013306618,
      "pose_mae_dtheta": 0.31079357862472534,
      "pose_mae_dx": 0.07779285311698914,
      "pose_mae_dy": 0.09544488042593002,
      "pose_rmse_dtheta": 0.5956464409828186,
      "pose_rmse_dx": 0.18598465621471405,
      "pose_rmse_dy": 0.20436780154705048,
      "pose_rmse_mean": 0.3286663293838501,
      "rmse_dtheta": 0.05912354961037636,
      "rmse_dx": 0.022848237305879593,
      "rmse_dy": 0.015806851908564568,
      "rmse_mean": 0.032592881470918655,
      "rotation_flip": 0.0073394495993852615,
      "sparse_tokens": 18402.0,
      "step": 10505,
      "turn_loss": 0.27321499586105347,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 23043.0,
      "epoch": 0.48810629994424826,
      "grad_norm": 0.6535753011703491,
      "learning_rate": 3.856783969359873e-07,
      "loss": 0.198,
      "mae_dtheta": 0.028747327625751495,
      "mae_dx": 0.012408784590661526,
      "mae_dy": 0.004658746533095837,
      "pose_mae_dtheta": 0.23276858031749725,
      "pose_mae_dx": 0.09650640934705734,
      "pose_mae_dy": 0.0696294754743576,
      "pose_rmse_dtheta": 0.45592305064201355,
      "pose_rmse_dx": 0.2283383458852768,
      "pose_rmse_dy": 0.16520416736602783,
      "pose_rmse_mean": 0.2831552028656006,
      "rmse_dtheta": 0.05024818703532219,
      "rmse_dx": 0.026337239891290665,
      "rmse_dy": 0.009081111289560795,
      "rmse_mean": 0.02855551242828369,
      "rotation_flip": 0.01001251582056284,
      "sparse_tokens": 16432.0,
      "step": 10506,
      "turn_loss": 0.22343482077121735,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4881527597100911,
      "grad_norm": 0.48792725801467896,
      "learning_rate": 3.851693383311722e-07,
      "loss": 0.1332,
      "mae_dtheta": 0.010996369644999504,
      "mae_dx": 0.003087463788688183,
      "mae_dy": 0.004288716707378626,
      "pose_mae_dtheta": 0.07668722420930862,
      "pose_mae_dx": 0.035764411091804504,
      "pose_mae_dy": 0.033969614654779434,
      "pose_rmse_dtheta": 0.16700910031795502,
      "pose_rmse_dx": 0.0905459076166153,
      "pose_rmse_dy": 0.0803418681025505,
      "pose_rmse_mean": 0.11263229697942734,
      "rmse_dtheta": 0.023955443874001503,
      "rmse_dx": 0.007717097643762827,
      "rmse_dy": 0.010145874693989754,
      "rmse_mean": 0.01393947284668684,
      "rotation_flip": 0.003971118945628405,
      "sparse_tokens": 32169.0,
      "step": 10507,
      "turn_loss": 0.13713745772838593,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.48819921947593387,
      "grad_norm": 0.5814101099967957,
      "learning_rate": 3.8466060244394253e-07,
      "loss": 0.1667,
      "mae_dtheta": 0.009154915809631348,
      "mae_dx": 0.0015998624730855227,
      "mae_dy": 0.0015466847689822316,
      "pose_mae_dtheta": 0.055881302803754807,
      "pose_mae_dx": 0.02089749276638031,
      "pose_mae_dy": 0.02438991144299507,
      "pose_rmse_dtheta": 0.12173836678266525,
      "pose_rmse_dx": 0.04973552003502846,
      "pose_rmse_dy": 0.05517343804240227,
      "pose_rmse_mean": 0.07554911077022552,
      "rmse_dtheta": 0.020065130665898323,
      "rmse_dx": 0.005141436588019133,
      "rmse_dy": 0.003008711850270629,
      "rmse_mean": 0.009405093267560005,
      "rotation_flip": 0.005229284055531025,
      "sparse_tokens": 32105.0,
      "step": 10508,
      "turn_loss": 0.07608537375926971,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.48824567924177664,
      "grad_norm": 0.7872553467750549,
      "learning_rate": 3.841521893098732e-07,
      "loss": 0.2584,
      "mae_dtheta": 0.030772393569350243,
      "mae_dx": 0.011627579107880592,
      "mae_dy": 0.005837594158947468,
      "pose_mae_dtheta": 0.21684321761131287,
      "pose_mae_dx": 0.09450574219226837,
      "pose_mae_dy": 0.07852302491664886,
      "pose_rmse_dtheta": 0.3925913870334625,
      "pose_rmse_dx": 0.2069738805294037,
      "pose_rmse_dy": 0.16947047412395477,
      "pose_rmse_mean": 0.256345272064209,
      "rmse_dtheta": 0.04833493381738663,
      "rmse_dx": 0.024526912719011307,
      "rmse_dy": 0.010927366092801094,
      "rmse_mean": 0.02792973816394806,
      "rotation_flip": 0.010158013552427292,
      "sparse_tokens": 16522.0,
      "step": 10509,
      "turn_loss": 0.2405310422182083,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4882921390076194,
      "grad_norm": 0.4558177590370178,
      "learning_rate": 3.8364409896451907e-07,
      "loss": 0.0928,
      "mae_dtheta": 0.009260589256882668,
      "mae_dx": 0.0012471051886677742,
      "mae_dy": 0.002247934229671955,
      "pose_mae_dtheta": 0.05907721072435379,
      "pose_mae_dx": 0.018172672018408775,
      "pose_mae_dy": 0.025677144527435303,
      "pose_rmse_dtheta": 0.1621549427509308,
      "pose_rmse_dx": 0.045026808977127075,
      "pose_rmse_dy": 0.06107296794652939,
      "pose_rmse_mean": 0.08941824734210968,
      "rmse_dtheta": 0.020923910662531853,
      "rmse_dx": 0.0038750385865569115,
      "rmse_dy": 0.005675315856933594,
      "rmse_mean": 0.010158088058233261,
      "rotation_flip": 0.0013582343235611916,
      "sparse_tokens": 32153.0,
      "step": 10510,
      "turn_loss": 0.07645778357982635,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.4883385987734622,
      "grad_norm": 0.3798041045665741,
      "learning_rate": 3.8313633144341164e-07,
      "loss": 0.0863,
      "mae_dtheta": 0.03358402103185654,
      "mae_dx": 0.009619302116334438,
      "mae_dy": 0.006456713657826185,
      "pose_mae_dtheta": 0.248799666762352,
      "pose_mae_dx": 0.07853247970342636,
      "pose_mae_dy": 0.06218288838863373,
      "pose_rmse_dtheta": 0.458698570728302,
      "pose_rmse_dx": 0.16794082522392273,
      "pose_rmse_dy": 0.16836896538734436,
      "pose_rmse_mean": 0.2650027871131897,
      "rmse_dtheta": 0.05308552831411362,
      "rmse_dx": 0.01982617937028408,
      "rmse_dy": 0.014794214628636837,
      "rmse_mean": 0.02923530898988247,
      "rotation_flip": 0.01365461852401495,
      "sparse_tokens": 21551.0,
      "step": 10511,
      "turn_loss": 0.2745748460292816,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.488385058539305,
      "grad_norm": 0.4711601138114929,
      "learning_rate": 3.826288867820577e-07,
      "loss": 0.0688,
      "mae_dtheta": 0.009942322038114071,
      "mae_dx": 0.0014349044067785144,
      "mae_dy": 0.0015890781069174409,
      "pose_mae_dtheta": 0.0650608018040657,
      "pose_mae_dx": 0.01521745603531599,
      "pose_mae_dy": 0.020954400300979614,
      "pose_rmse_dtheta": 0.17883187532424927,
      "pose_rmse_dx": 0.039307430386543274,
      "pose_rmse_dy": 0.055046677589416504,
      "pose_rmse_mean": 0.09106199443340302,
      "rmse_dtheta": 0.025312434881925583,
      "rmse_dx": 0.004308433271944523,
      "rmse_dy": 0.0036050721537321806,
      "rmse_mean": 0.011075313203036785,
      "rotation_flip": 0.002334630349650979,
      "sparse_tokens": 32185.0,
      "step": 10512,
      "turn_loss": 0.0712747797369957,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.48843151830514775,
      "grad_norm": 0.33379265666007996,
      "learning_rate": 3.821217650159453e-07,
      "loss": 0.0742,
      "mae_dtheta": 0.008564869873225689,
      "mae_dx": 0.0018584912177175283,
      "mae_dy": 0.002542468486353755,
      "pose_mae_dtheta": 0.05843472108244896,
      "pose_mae_dx": 0.019806362688541412,
      "pose_mae_dy": 0.024597277864813805,
      "pose_rmse_dtheta": 0.15303461253643036,
      "pose_rmse_dx": 0.05509275197982788,
      "pose_rmse_dy": 0.059720370918512344,
      "pose_rmse_mean": 0.08928258717060089,
      "rmse_dtheta": 0.020576009526848793,
      "rmse_dx": 0.006217801943421364,
      "rmse_dy": 0.006761568132787943,
      "rmse_mean": 0.011185127310454845,
      "rotation_flip": 0.004172989167273045,
      "sparse_tokens": 32137.0,
      "step": 10513,
      "turn_loss": 0.08038456737995148,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.4884779780709905,
      "grad_norm": 0.5770001411437988,
      "learning_rate": 3.816149661805352e-07,
      "loss": 0.1532,
      "mae_dtheta": 0.03520750254392624,
      "mae_dx": 0.01479673758149147,
      "mae_dy": 0.008279962465167046,
      "pose_mae_dtheta": 0.26991572976112366,
      "pose_mae_dx": 0.12372961640357971,
      "pose_mae_dy": 0.1044149324297905,
      "pose_rmse_dtheta": 0.4531923234462738,
      "pose_rmse_dx": 0.27535951137542725,
      "pose_rmse_dy": 0.18789322674274445,
      "pose_rmse_mean": 0.3054817020893097,
      "rmse_dtheta": 0.05071093142032623,
      "rmse_dx": 0.029239097610116005,
      "rmse_dy": 0.013873275369405746,
      "rmse_mean": 0.03127443417906761,
      "rotation_flip": 0.015105740167200565,
      "sparse_tokens": 11505.0,
      "step": 10514,
      "turn_loss": 0.33348315954208374,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4885244378368333,
      "grad_norm": 0.40441587567329407,
      "learning_rate": 3.8110849031127e-07,
      "loss": 0.1173,
      "mae_dtheta": 0.008983965963125229,
      "mae_dx": 0.001998085295781493,
      "mae_dy": 0.002358207944780588,
      "pose_mae_dtheta": 0.058901768177747726,
      "pose_mae_dx": 0.022795913740992546,
      "pose_mae_dy": 0.026544421911239624,
      "pose_rmse_dtheta": 0.12020688503980637,
      "pose_rmse_dx": 0.06221557781100273,
      "pose_rmse_dy": 0.060445625334978104,
      "pose_rmse_mean": 0.08095602691173553,
      "rmse_dtheta": 0.01842389442026615,
      "rmse_dx": 0.005904681980609894,
      "rmse_dy": 0.005185249261558056,
      "rmse_mean": 0.009837942197918892,
      "rotation_flip": 0.0015414258232340217,
      "sparse_tokens": 32073.0,
      "step": 10515,
      "turn_loss": 0.09942875802516937,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4885708976026761,
      "grad_norm": 0.5796961784362793,
      "learning_rate": 3.8060233744356634e-07,
      "loss": 0.1071,
      "mae_dtheta": 0.013077991083264351,
      "mae_dx": 0.0013919974444434047,
      "mae_dy": 0.002351664938032627,
      "pose_mae_dtheta": 0.08581428974866867,
      "pose_mae_dx": 0.022287525236606598,
      "pose_mae_dy": 0.032969627529382706,
      "pose_rmse_dtheta": 0.22945745289325714,
      "pose_rmse_dx": 0.05355026572942734,
      "pose_rmse_dy": 0.07607167959213257,
      "pose_rmse_mean": 0.11969313025474548,
      "rmse_dtheta": 0.027374474331736565,
      "rmse_dx": 0.003990123514086008,
      "rmse_dy": 0.00436624139547348,
      "rmse_mean": 0.011910280212759972,
      "rotation_flip": 0.002613890916109085,
      "sparse_tokens": 32073.0,
      "step": 10516,
      "turn_loss": 0.08241266012191772,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.48861735736851886,
      "grad_norm": 0.8063806891441345,
      "learning_rate": 3.8009650761282104e-07,
      "loss": 0.1472,
      "mae_dtheta": 0.011300652287900448,
      "mae_dx": 0.003950465004891157,
      "mae_dy": 0.0023483827244490385,
      "pose_mae_dtheta": 0.07747088372707367,
      "pose_mae_dx": 0.04049275815486908,
      "pose_mae_dy": 0.03166459873318672,
      "pose_rmse_dtheta": 0.18486081063747406,
      "pose_rmse_dx": 0.13176652789115906,
      "pose_rmse_dy": 0.08352145552635193,
      "pose_rmse_mean": 0.13338293135166168,
      "rmse_dtheta": 0.02416006289422512,
      "rmse_dx": 0.01332761999219656,
      "rmse_dy": 0.005602456629276276,
      "rmse_mean": 0.014363380149006844,
      "rotation_flip": 0.0020929258316755295,
      "sparse_tokens": 32105.0,
      "step": 10517,
      "turn_loss": 0.13237105309963226,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.48866381713436163,
      "grad_norm": 0.32911917567253113,
      "learning_rate": 3.795910008544074e-07,
      "loss": 0.0881,
      "mae_dtheta": 0.008329258300364017,
      "mae_dx": 0.0018033958040177822,
      "mae_dy": 0.0023760548792779446,
      "pose_mae_dtheta": 0.05543787404894829,
      "pose_mae_dx": 0.020161664113402367,
      "pose_mae_dy": 0.02188817784190178,
      "pose_rmse_dtheta": 0.1632654219865799,
      "pose_rmse_dx": 0.05728714540600777,
      "pose_rmse_dy": 0.04745706543326378,
      "pose_rmse_mean": 0.08933654427528381,
      "rmse_dtheta": 0.0194240715354681,
      "rmse_dx": 0.005650471895933151,
      "rmse_dy": 0.005456498358398676,
      "rmse_mean": 0.010177014395594597,
      "rotation_flip": 0.000363240105798468,
      "sparse_tokens": 32137.0,
      "step": 10518,
      "turn_loss": 0.06260877847671509,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4887102769002044,
      "grad_norm": 0.4468247890472412,
      "learning_rate": 3.790858172036738e-07,
      "loss": 0.0937,
      "mae_dtheta": 0.01174567174166441,
      "mae_dx": 0.0037853424437344074,
      "mae_dy": 0.005528385750949383,
      "pose_mae_dtheta": 0.08028395473957062,
      "pose_mae_dx": 0.0429827980697155,
      "pose_mae_dy": 0.04891883581876755,
      "pose_rmse_dtheta": 0.1595727950334549,
      "pose_rmse_dx": 0.11805617809295654,
      "pose_rmse_dy": 0.1306503862142563,
      "pose_rmse_mean": 0.1360931247472763,
      "rmse_dtheta": 0.02262995019555092,
      "rmse_dx": 0.010375921614468098,
      "rmse_dy": 0.012821086682379246,
      "rmse_mean": 0.015275652520358562,
      "rotation_flip": 0.004787961486726999,
      "sparse_tokens": 32057.0,
      "step": 10519,
      "turn_loss": 0.1367063969373703,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.4887567366660472,
      "grad_norm": 0.4092473089694977,
      "learning_rate": 3.785809566959503e-07,
      "loss": 0.0971,
      "mae_dtheta": 0.04976125434041023,
      "mae_dx": 0.01091216690838337,
      "mae_dy": 0.002664153929799795,
      "pose_mae_dtheta": 0.4120992124080658,
      "pose_mae_dx": 0.08758290112018585,
      "pose_mae_dy": 0.027027104049921036,
      "pose_rmse_dtheta": 0.668116569519043,
      "pose_rmse_dx": 0.19850841164588928,
      "pose_rmse_dy": 0.06343249976634979,
      "pose_rmse_mean": 0.3100191652774811,
      "rmse_dtheta": 0.06893369555473328,
      "rmse_dx": 0.022643480449914932,
      "rmse_dy": 0.005776893347501755,
      "rmse_mean": 0.03245135769248009,
      "rotation_flip": 0.012886597774922848,
      "sparse_tokens": 6475.0,
      "step": 10520,
      "turn_loss": 0.2509264647960663,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 1980.0,
      "epoch": 0.48880319643188996,
      "grad_norm": 0.45110228657722473,
      "learning_rate": 3.7807641936653984e-07,
      "loss": 0.1096,
      "mae_dtheta": 0.027049990370869637,
      "mae_dx": 0.027619900181889534,
      "mae_dy": 0.01319215726107359,
      "pose_mae_dtheta": 0.15188325941562653,
      "pose_mae_dx": 0.17188027501106262,
      "pose_mae_dy": 0.13608506321907043,
      "pose_rmse_dtheta": 0.22820818424224854,
      "pose_rmse_dx": 0.30012544989585876,
      "pose_rmse_dy": 0.20041659474372864,
      "pose_rmse_mean": 0.2429167479276657,
      "rmse_dtheta": 0.03377494961023331,
      "rmse_dx": 0.040648795664310455,
      "rmse_dy": 0.018768414855003357,
      "rmse_mean": 0.031064053997397423,
      "rotation_flip": 0.0,
      "sparse_tokens": 1599.0,
      "step": 10521,
      "turn_loss": 0.5606390833854675,
      "turns": 6.0,
      "turns_per_sample": 6.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.48884965619773274,
      "grad_norm": 0.47038182616233826,
      "learning_rate": 3.775722052507269e-07,
      "loss": 0.1246,
      "mae_dtheta": 0.006221546325832605,
      "mae_dx": 0.0012441586004570127,
      "mae_dy": 0.0006350846961140633,
      "pose_mae_dtheta": 0.04696418717503548,
      "pose_mae_dx": 0.010917311534285545,
      "pose_mae_dy": 0.007838013581931591,
      "pose_rmse_dtheta": 0.1999574452638626,
      "pose_rmse_dx": 0.027999069541692734,
      "pose_rmse_dy": 0.023072561249136925,
      "pose_rmse_mean": 0.08367636054754257,
      "rmse_dtheta": 0.02237820066511631,
      "rmse_dx": 0.0038378608878701925,
      "rmse_dy": 0.0015283741522580385,
      "rmse_mean": 0.00924814585596323,
      "rotation_flip": 0.0016652789199724793,
      "sparse_tokens": 32233.0,
      "step": 10522,
      "turn_loss": 0.0414448082447052,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.4888961159635755,
      "grad_norm": 0.9259507656097412,
      "learning_rate": 3.7706831438377056e-07,
      "loss": 0.2042,
      "mae_dtheta": 0.029103735461831093,
      "mae_dx": 0.007771036121994257,
      "mae_dy": 0.0048308223485946655,
      "pose_mae_dtheta": 0.2255440652370453,
      "pose_mae_dx": 0.043102093040943146,
      "pose_mae_dy": 0.04317016899585724,
      "pose_rmse_dtheta": 0.4027884304523468,
      "pose_rmse_dx": 0.0962924063205719,
      "pose_rmse_dy": 0.08662423491477966,
      "pose_rmse_mean": 0.195235013961792,
      "rmse_dtheta": 0.04556020349264145,
      "rmse_dx": 0.017389701679348946,
      "rmse_dy": 0.00842814426869154,
      "rmse_mean": 0.023792682215571404,
      "rotation_flip": 0.010273972526192665,
      "sparse_tokens": 4705.0,
      "step": 10523,
      "turn_loss": 0.25934141874313354,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.48894257572941835,
      "grad_norm": 0.5009093284606934,
      "learning_rate": 3.765647468009076e-07,
      "loss": 0.1081,
      "mae_dtheta": 0.01445868518203497,
      "mae_dx": 0.0018136586295440793,
      "mae_dy": 0.0033078957349061966,
      "pose_mae_dtheta": 0.09434147924184799,
      "pose_mae_dx": 0.02696172706782818,
      "pose_mae_dy": 0.037182580679655075,
      "pose_rmse_dtheta": 0.20078587532043457,
      "pose_rmse_dx": 0.07126617431640625,
      "pose_rmse_dy": 0.08478790521621704,
      "pose_rmse_mean": 0.11894665658473969,
      "rmse_dtheta": 0.027826515957713127,
      "rmse_dx": 0.004584972281008959,
      "rmse_dy": 0.006411072798073292,
      "rmse_mean": 0.012940853834152222,
      "rotation_flip": 0.005171299446374178,
      "sparse_tokens": 32121.0,
      "step": 10524,
      "turn_loss": 0.11470416933298111,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4889890354952611,
      "grad_norm": 0.5380401611328125,
      "learning_rate": 3.760615025373543e-07,
      "loss": 0.1022,
      "mae_dtheta": 0.00663937721401453,
      "mae_dx": 0.0012715535704046488,
      "mae_dy": 0.0018935112748295069,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.538040280342102,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.32102966308594,
      "model/head/act_norm_mean": 114.46762547348484,
      "model/head/act_norm_min": 71.070556640625,
      "model/head/act_over_embed": 78.6632238881728,
      "model/head/grad_frac": 0.10789463669061661,
      "model/head/grad_norm": 0.058051660656929016,
      "model/head/grad_zero_frac": 0.00012024599709548056,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7076428345959596,
      "model/head/update_ratio": 0.0009882358135655522,
      "model/head/weight_delta": 9.970796585083008,
      "model/head/weight_delta_rel": 0.1749173104763031,
      "model/head/weight_norm": 58.74271774291992,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228760302066803,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228086691298243,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227178394794464,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905580758231412,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09548792988061905,
      "model/modality_embedder.encoders.pose/grad_norm": 0.051376353949308395,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.519333237327189,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016589108854532242,
      "model/modality_embedder.encoders.pose/weight_delta": 3.15384840965271,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10304605960845947,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96993064880371,
      "model/modality_embedder/grad_frac": 0.09548792988061905,
      "model/modality_embedder/grad_norm": 0.051376353949308395,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.519333237327189,
      "model/modality_embedder/update_ratio": 0.0016589108854532242,
      "model/modality_embedder/weight_delta": 3.15384840965271,
      "model/modality_embedder/weight_delta_rel": 0.10304605960845947,
      "model/modality_embedder/weight_norm": 30.96993064880371,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.01519012451172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.045284191117524,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.070690155029297,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.524144411633312,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0758332759141922,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.040801357477903366,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0014593031955882907,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7345376014709473,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09964819997549057,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.9594783782959,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.2983169555664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.013588263588264,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.255280494689941,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.189572035640758,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08662809431552887,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04660940542817116,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015657552285119891,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.466991662979126,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12009929865598679,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.768001556396484,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.88980102539062,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.825674903799904,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.243142127990723,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.434854939816613,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0860796794295311,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.046314336359500885,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015066732885316014,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.755850076675415,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12611441314220428,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.739469528198242,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.68351745605469,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.514943582651917,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.234566688537598,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.59573619110626,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08347104489803314,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04491078481078148,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00011600225843722001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014993755612522364,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2275679111480713,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11030295491218567,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.952991485595703,
      "model/normalizer/grad_frac": 0.31429001688957214,
      "model/normalizer/grad_norm": 0.16910068690776825,
      "model/normalizer/grad_zero_frac": 0.00015480772708542645,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021499106660485268,
      "model/normalizer/weight_delta": 6.78923225402832,
      "model/normalizer/weight_delta_rel": 0.08744137734174728,
      "model/normalizer/weight_norm": 78.65474700927734,
      "pose_mae_dtheta": 0.0437089279294014,
      "pose_mae_dx": 0.019203107804059982,
      "pose_mae_dy": 0.021339111030101776,
      "pose_rmse_dtheta": 0.08911697566509247,
      "pose_rmse_dx": 0.05617854744195938,
      "pose_rmse_dy": 0.05062360689043999,
      "pose_rmse_mean": 0.06530638039112091,
      "rmse_dtheta": 0.015198000706732273,
      "rmse_dx": 0.0038513129111379385,
      "rmse_dy": 0.00436820276081562,
      "rmse_mean": 0.007805838715285063,
      "rotation_flip": 0.00555812893435359,
      "sparse_tokens": 32057.0,
      "step": 10525,
      "turn_loss": 0.07235299050807953,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.4890354952611039,
      "grad_norm": 0.6509034633636475,
      "learning_rate": 3.755585816283014e-07,
      "loss": 0.144,
      "mae_dtheta": 0.019790560007095337,
      "mae_dx": 0.008378172293305397,
      "mae_dy": 0.005011811852455139,
      "pose_mae_dtheta": 0.1522088199853897,
      "pose_mae_dx": 0.053358759731054306,
      "pose_mae_dy": 0.08264388144016266,
      "pose_rmse_dtheta": 0.30947843194007874,
      "pose_rmse_dx": 0.15109334886074066,
      "pose_rmse_dy": 0.20717355608940125,
      "pose_rmse_mean": 0.22258178889751434,
      "rmse_dtheta": 0.03413798287510872,
      "rmse_dx": 0.021316731348633766,
      "rmse_dy": 0.010908237658441067,
      "rmse_mean": 0.022120986133813858,
      "rotation_flip": 0.01246882788836956,
      "sparse_tokens": 8053.0,
      "step": 10526,
      "turn_loss": 0.1610378473997116,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.4890819550269467,
      "grad_norm": 0.621010959148407,
      "learning_rate": 3.750559841089196e-07,
      "loss": 0.1754,
      "mae_dtheta": 0.008854190818965435,
      "mae_dx": 0.0013141529634594917,
      "mae_dy": 0.0019899681210517883,
      "pose_mae_dtheta": 0.05710639804601669,
      "pose_mae_dx": 0.014981859363615513,
      "pose_mae_dy": 0.019187910482287407,
      "pose_rmse_dtheta": 0.19077540934085846,
      "pose_rmse_dx": 0.03491278737783432,
      "pose_rmse_dy": 0.044634558260440826,
      "pose_rmse_mean": 0.09010758250951767,
      "rmse_dtheta": 0.023315561935305595,
      "rmse_dx": 0.0031352220103144646,
      "rmse_dy": 0.004407332744449377,
      "rmse_mean": 0.010286038741469383,
      "rotation_flip": 0.007924527861177921,
      "sparse_tokens": 32169.0,
      "step": 10527,
      "turn_loss": 0.07391856610774994,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.48912841479278946,
      "grad_norm": 0.4936714172363281,
      "learning_rate": 3.745537100143548e-07,
      "loss": 0.1265,
      "mae_dtheta": 0.03315559774637222,
      "mae_dx": 0.014454398304224014,
      "mae_dy": 0.006614744197577238,
      "pose_mae_dtheta": 0.2307225614786148,
      "pose_mae_dx": 0.09506727755069733,
      "pose_mae_dy": 0.06556903570890427,
      "pose_rmse_dtheta": 0.44665998220443726,
      "pose_rmse_dx": 0.22126352787017822,
      "pose_rmse_dy": 0.16520100831985474,
      "pose_rmse_mean": 0.27770817279815674,
      "rmse_dtheta": 0.05193403363227844,
      "rmse_dx": 0.027862826362252235,
      "rmse_dy": 0.013449911959469318,
      "rmse_mean": 0.031082257628440857,
      "rotation_flip": 0.007886434905230999,
      "sparse_tokens": 12665.0,
      "step": 10528,
      "turn_loss": 0.2904624044895172,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.48917487455863223,
      "grad_norm": 0.5219829678535461,
      "learning_rate": 3.7405175937973103e-07,
      "loss": 0.1474,
      "mae_dtheta": 0.01113544125109911,
      "mae_dx": 0.0016814994160085917,
      "mae_dy": 0.002842383459210396,
      "pose_mae_dtheta": 0.08003244549036026,
      "pose_mae_dx": 0.026774704456329346,
      "pose_mae_dy": 0.03669484704732895,
      "pose_rmse_dtheta": 0.19012977182865143,
      "pose_rmse_dx": 0.06735332310199738,
      "pose_rmse_dy": 0.091257743537426,
      "pose_rmse_mean": 0.11624695360660553,
      "rmse_dtheta": 0.024244245141744614,
      "rmse_dx": 0.004436372313648462,
      "rmse_dy": 0.006460090633481741,
      "rmse_mean": 0.011713569983839989,
      "rotation_flip": 0.005177770275622606,
      "sparse_tokens": 32121.0,
      "step": 10529,
      "turn_loss": 0.09268876165151596,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.489221334324475,
      "grad_norm": 0.343659907579422,
      "learning_rate": 3.735501322401519e-07,
      "loss": 0.0634,
      "mae_dtheta": 0.004318901803344488,
      "mae_dx": 0.0011999233392998576,
      "mae_dy": 0.00029206127510406077,
      "pose_mae_dtheta": 0.03073827549815178,
      "pose_mae_dx": 0.009426559321582317,
      "pose_mae_dy": 0.004876274149864912,
      "pose_rmse_dtheta": 0.12997813522815704,
      "pose_rmse_dx": 0.025454677641391754,
      "pose_rmse_dy": 0.014205985702574253,
      "pose_rmse_mean": 0.05654627084732056,
      "rmse_dtheta": 0.01794220320880413,
      "rmse_dx": 0.0036743679083883762,
      "rmse_dy": 0.0006927186041139066,
      "rmse_mean": 0.007436429616063833,
      "rotation_flip": 0.0,
      "sparse_tokens": 32169.0,
      "step": 10530,
      "turn_loss": 0.03700106963515282,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25958.0,
      "epoch": 0.4892677940903178,
      "grad_norm": 0.5461665391921997,
      "learning_rate": 3.730488286306944e-07,
      "loss": 0.1208,
      "mae_dtheta": 0.03039940446615219,
      "mae_dx": 0.013574822805821896,
      "mae_dy": 0.003790271934121847,
      "pose_mae_dtheta": 0.23413705825805664,
      "pose_mae_dx": 0.09789488464593887,
      "pose_mae_dy": 0.05234210193157196,
      "pose_rmse_dtheta": 0.4656629264354706,
      "pose_rmse_dx": 0.2142646610736847,
      "pose_rmse_dy": 0.14624768495559692,
      "pose_rmse_mean": 0.27539175748825073,
      "rmse_dtheta": 0.05108331888914108,
      "rmse_dx": 0.026382647454738617,
      "rmse_dy": 0.007900269702076912,
      "rmse_mean": 0.02845541201531887,
      "rotation_flip": 0.011659192852675915,
      "sparse_tokens": 21006.0,
      "step": 10531,
      "turn_loss": 0.24828970432281494,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.48931425385616056,
      "grad_norm": 0.7287015914916992,
      "learning_rate": 3.725478485864165e-07,
      "loss": 0.1081,
      "mae_dtheta": 0.006939534563571215,
      "mae_dx": 0.0015303236432373524,
      "mae_dy": 0.001681884634308517,
      "pose_mae_dtheta": 0.04610997065901756,
      "pose_mae_dx": 0.01692548580467701,
      "pose_mae_dy": 0.01876317337155342,
      "pose_rmse_dtheta": 0.12532001733779907,
      "pose_rmse_dx": 0.04720163717865944,
      "pose_rmse_dy": 0.04248940944671631,
      "pose_rmse_mean": 0.07167035341262817,
      "rmse_dtheta": 0.01760409027338028,
      "rmse_dx": 0.005120653659105301,
      "rmse_dy": 0.004195982124656439,
      "rmse_mean": 0.008973576128482819,
      "rotation_flip": 0.003189792623743415,
      "sparse_tokens": 32073.0,
      "step": 10532,
      "turn_loss": 0.05988287553191185,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.48936071362200334,
      "grad_norm": 0.6315100789070129,
      "learning_rate": 3.7204719214235016e-07,
      "loss": 0.1172,
      "mae_dtheta": 0.009161443449556828,
      "mae_dx": 0.0014604126336053014,
      "mae_dy": 0.0019010193645954132,
      "pose_mae_dtheta": 0.0637337863445282,
      "pose_mae_dx": 0.01928328536450863,
      "pose_mae_dy": 0.023785872384905815,
      "pose_rmse_dtheta": 0.1647137850522995,
      "pose_rmse_dx": 0.050898171961307526,
      "pose_rmse_dy": 0.059254541993141174,
      "pose_rmse_mean": 0.09162217378616333,
      "rmse_dtheta": 0.020764384418725967,
      "rmse_dx": 0.004643437452614307,
      "rmse_dy": 0.0045294794254004955,
      "rmse_mean": 0.00997910089790821,
      "rotation_flip": 0.0025850925594568253,
      "sparse_tokens": 32121.0,
      "step": 10533,
      "turn_loss": 0.07794612646102905,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.4894071733878461,
      "grad_norm": 0.6420037150382996,
      "learning_rate": 3.7154685933350864e-07,
      "loss": 0.1738,
      "mae_dtheta": 0.030458595603704453,
      "mae_dx": 0.0115445451810956,
      "mae_dy": 0.0033085374161601067,
      "pose_mae_dtheta": 0.22645917534828186,
      "pose_mae_dx": 0.10267379879951477,
      "pose_mae_dy": 0.038344867527484894,
      "pose_rmse_dtheta": 0.42517563700675964,
      "pose_rmse_dx": 0.23179315030574799,
      "pose_rmse_dy": 0.10055898874998093,
      "pose_rmse_mean": 0.2525092661380768,
      "rmse_dtheta": 0.04794498160481453,
      "rmse_dx": 0.024655716493725777,
      "rmse_dy": 0.006553282495588064,
      "rmse_mean": 0.026384662836790085,
      "rotation_flip": 0.004975124262273312,
      "sparse_tokens": 6764.0,
      "step": 10534,
      "turn_loss": 0.2111717164516449,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.4894536331536889,
      "grad_norm": 0.38243231177330017,
      "learning_rate": 3.7104685019488e-07,
      "loss": 0.1049,
      "mae_dtheta": 0.023875124752521515,
      "mae_dx": 0.0035994655918329954,
      "mae_dy": 0.0021612970158457756,
      "pose_mae_dtheta": 0.16862531006336212,
      "pose_mae_dx": 0.02689853310585022,
      "pose_mae_dy": 0.026323948055505753,
      "pose_rmse_dtheta": 0.4141543209552765,
      "pose_rmse_dx": 0.08879458159208298,
      "pose_rmse_dy": 0.052606843411922455,
      "pose_rmse_mean": 0.1851852387189865,
      "rmse_dtheta": 0.04613089561462402,
      "rmse_dx": 0.012009041383862495,
      "rmse_dy": 0.003980490379035473,
      "rmse_mean": 0.02070681005716324,
      "rotation_flip": 0.01875000074505806,
      "sparse_tokens": 8795.0,
      "step": 10535,
      "turn_loss": 0.18874119222164154,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.48950009291953167,
      "grad_norm": 0.6568700671195984,
      "learning_rate": 3.705471647614284e-07,
      "loss": 0.0848,
      "mae_dtheta": 0.03950107470154762,
      "mae_dx": 0.012364386580884457,
      "mae_dy": 0.006047169212251902,
      "pose_mae_dtheta": 0.32026368379592896,
      "pose_mae_dx": 0.08689028024673462,
      "pose_mae_dy": 0.04439416900277138,
      "pose_rmse_dtheta": 0.4767061769962311,
      "pose_rmse_dx": 0.20239149034023285,
      "pose_rmse_dy": 0.09135433286428452,
      "pose_rmse_mean": 0.2568173408508301,
      "rmse_dtheta": 0.05717870593070984,
      "rmse_dx": 0.023305745795369148,
      "rmse_dy": 0.013147925958037376,
      "rmse_mean": 0.031210793182253838,
      "rotation_flip": 0.026490066200494766,
      "sparse_tokens": 4269.0,
      "step": 10536,
      "turn_loss": 0.34298980236053467,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.48954655268537445,
      "grad_norm": 0.5574265122413635,
      "learning_rate": 3.7004780306809873e-07,
      "loss": 0.1078,
      "mae_dtheta": 0.022996727377176285,
      "mae_dx": 0.010174894705414772,
      "mae_dy": 0.005165854934602976,
      "pose_mae_dtheta": 0.16003449261188507,
      "pose_mae_dx": 0.08436714112758636,
      "pose_mae_dy": 0.056736674159765244,
      "pose_rmse_dtheta": 0.2541560232639313,
      "pose_rmse_dx": 0.18278761208057404,
      "pose_rmse_dy": 0.1261066049337387,
      "pose_rmse_mean": 0.18768343329429626,
      "rmse_dtheta": 0.03358709067106247,
      "rmse_dx": 0.022291311994194984,
      "rmse_dy": 0.009125260636210442,
      "rmse_mean": 0.02166788838803768,
      "rotation_flip": 0.021276595070958138,
      "sparse_tokens": 4516.0,
      "step": 10537,
      "turn_loss": 0.25654923915863037,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4895930124512172,
      "grad_norm": 0.4594930112361908,
      "learning_rate": 3.6954876514981084e-07,
      "loss": 0.0887,
      "mae_dtheta": 0.004238419700413942,
      "mae_dx": 0.0011023961706086993,
      "mae_dy": 0.00048441014951094985,
      "pose_mae_dtheta": 0.029851041734218597,
      "pose_mae_dx": 0.011054362170398235,
      "pose_mae_dy": 0.007543080486357212,
      "pose_rmse_dtheta": 0.137213796377182,
      "pose_rmse_dx": 0.03105127066373825,
      "pose_rmse_dy": 0.02377832494676113,
      "pose_rmse_mean": 0.06401446461677551,
      "rmse_dtheta": 0.017980918288230896,
      "rmse_dx": 0.0038944650441408157,
      "rmse_dy": 0.0012074016267433763,
      "rmse_mean": 0.007694262079894543,
      "rotation_flip": 0.0015003751032054424,
      "sparse_tokens": 32105.0,
      "step": 10538,
      "turn_loss": 0.030117427930235863,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.48963947221706,
      "grad_norm": 0.44702333211898804,
      "learning_rate": 3.690500510414641e-07,
      "loss": 0.1084,
      "mae_dtheta": 0.03630024194717407,
      "mae_dx": 0.014522883109748363,
      "mae_dy": 0.003029957879334688,
      "pose_mae_dtheta": 0.26675111055374146,
      "pose_mae_dx": 0.11796782910823822,
      "pose_mae_dy": 0.05232492834329605,
      "pose_rmse_dtheta": 0.45196670293807983,
      "pose_rmse_dx": 0.2556147575378418,
      "pose_rmse_dy": 0.12298766523599625,
      "pose_rmse_mean": 0.276856392621994,
      "rmse_dtheta": 0.052843451499938965,
      "rmse_dx": 0.02852601371705532,
      "rmse_dy": 0.006336805876344442,
      "rmse_mean": 0.02923542633652687,
      "rotation_flip": 0.014450866729021072,
      "sparse_tokens": 5790.0,
      "step": 10539,
      "turn_loss": 0.30155953764915466,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.48968593198290283,
      "grad_norm": 0.6263106465339661,
      "learning_rate": 3.6855166077793156e-07,
      "loss": 0.118,
      "mae_dtheta": 0.00980315450578928,
      "mae_dx": 0.002579139545559883,
      "mae_dy": 0.002686438849195838,
      "pose_mae_dtheta": 0.06965245306491852,
      "pose_mae_dx": 0.023990696296095848,
      "pose_mae_dy": 0.023353099822998047,
      "pose_rmse_dtheta": 0.17378927767276764,
      "pose_rmse_dx": 0.052690282464027405,
      "pose_rmse_dy": 0.05390479415655136,
      "pose_rmse_mean": 0.09346145391464233,
      "rmse_dtheta": 0.023659279569983482,
      "rmse_dx": 0.00693031819537282,
      "rmse_dy": 0.006739623844623566,
      "rmse_mean": 0.012443073093891144,
      "rotation_flip": 0.005647438578307629,
      "sparse_tokens": 32105.0,
      "step": 10540,
      "turn_loss": 0.10840412229299545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35578.0,
      "epoch": 0.4897323917487456,
      "grad_norm": 0.6043504476547241,
      "learning_rate": 3.680535943940688e-07,
      "loss": 0.1497,
      "mae_dtheta": 0.03791847825050354,
      "mae_dx": 0.011336874216794968,
      "mae_dy": 0.004439453594386578,
      "pose_mae_dtheta": 0.29760706424713135,
      "pose_mae_dx": 0.09068755805492401,
      "pose_mae_dy": 0.048848990350961685,
      "pose_rmse_dtheta": 0.5265671014785767,
      "pose_rmse_dx": 0.21937888860702515,
      "pose_rmse_dy": 0.14090433716773987,
      "pose_rmse_mean": 0.2956168055534363,
      "rmse_dtheta": 0.056853387504816055,
      "rmse_dx": 0.023808272555470467,
      "rmse_dy": 0.01187796052545309,
      "rmse_mean": 0.03084654174745083,
      "rotation_flip": 0.016597511246800423,
      "sparse_tokens": 28472.0,
      "step": 10541,
      "turn_loss": 0.30098745226860046,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.4897788515145884,
      "grad_norm": 0.5826020240783691,
      "learning_rate": 3.67555851924703e-07,
      "loss": 0.1494,
      "mae_dtheta": 0.042082950472831726,
      "mae_dx": 0.013770139776170254,
      "mae_dy": 0.005127384327352047,
      "pose_mae_dtheta": 0.33718520402908325,
      "pose_mae_dx": 0.10240469872951508,
      "pose_mae_dy": 0.06182020902633667,
      "pose_rmse_dtheta": 0.5564878582954407,
      "pose_rmse_dx": 0.20699620246887207,
      "pose_rmse_dy": 0.17397193610668182,
      "pose_rmse_mean": 0.31248533725738525,
      "rmse_dtheta": 0.058133840560913086,
      "rmse_dx": 0.025617580860853195,
      "rmse_dy": 0.011365300044417381,
      "rmse_mean": 0.0317055769264698,
      "rotation_flip": 0.006535947788506746,
      "sparse_tokens": 9616.0,
      "step": 10542,
      "turn_loss": 0.2932587265968323,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.48982531128043116,
      "grad_norm": 0.5880939960479736,
      "learning_rate": 3.6705843340464287e-07,
      "loss": 0.1684,
      "mae_dtheta": 0.02747785858809948,
      "mae_dx": 0.007739622611552477,
      "mae_dy": 0.006684505380690098,
      "pose_mae_dtheta": 0.19833554327487946,
      "pose_mae_dx": 0.05762643367052078,
      "pose_mae_dy": 0.06124982237815857,
      "pose_rmse_dtheta": 0.34888434410095215,
      "pose_rmse_dx": 0.11127118766307831,
      "pose_rmse_dy": 0.13669529557228088,
      "pose_rmse_mean": 0.19895029067993164,
      "rmse_dtheta": 0.04638119786977768,
      "rmse_dx": 0.014737456105649471,
      "rmse_dy": 0.01445520855486393,
      "rmse_mean": 0.0251912884414196,
      "rotation_flip": 0.022641509771347046,
      "sparse_tokens": 4479.0,
      "step": 10543,
      "turn_loss": 0.2685244381427765,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.48987177104627394,
      "grad_norm": 0.5011990070343018,
      "learning_rate": 3.6656133886867396e-07,
      "loss": 0.112,
      "mae_dtheta": 0.0223854873329401,
      "mae_dx": 0.010542514733970165,
      "mae_dy": 0.00770172942429781,
      "pose_mae_dtheta": 0.16831763088703156,
      "pose_mae_dx": 0.09285391122102737,
      "pose_mae_dy": 0.0725620910525322,
      "pose_rmse_dtheta": 0.28890931606292725,
      "pose_rmse_dx": 0.21256347000598907,
      "pose_rmse_dy": 0.13492469489574432,
      "pose_rmse_mean": 0.2121324986219406,
      "rmse_dtheta": 0.035859860479831696,
      "rmse_dx": 0.023244937881827354,
      "rmse_dy": 0.016292385756969452,
      "rmse_mean": 0.025132395327091217,
      "rotation_flip": 0.003401360474526882,
      "sparse_tokens": 6643.0,
      "step": 10544,
      "turn_loss": 0.26175442337989807,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4899182308121167,
      "grad_norm": 0.4644024074077606,
      "learning_rate": 3.660645683515568e-07,
      "loss": 0.0731,
      "mae_dtheta": 0.010421029292047024,
      "mae_dx": 0.002705817809328437,
      "mae_dy": 0.0033026114106178284,
      "pose_mae_dtheta": 0.076427161693573,
      "pose_mae_dx": 0.03496846184134483,
      "pose_mae_dy": 0.0317237563431263,
      "pose_rmse_dtheta": 0.1827831119298935,
      "pose_rmse_dx": 0.1152450293302536,
      "pose_rmse_dy": 0.08605293929576874,
      "pose_rmse_mean": 0.1280270218849182,
      "rmse_dtheta": 0.023435894399881363,
      "rmse_dx": 0.00746932765468955,
      "rmse_dy": 0.008040009997785091,
      "rmse_mean": 0.012981744483113289,
      "rotation_flip": 0.008420208469033241,
      "sparse_tokens": 32121.0,
      "step": 10545,
      "turn_loss": 0.11639497429132462,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4899646905779595,
      "grad_norm": 0.4322208762168884,
      "learning_rate": 3.655681218880325e-07,
      "loss": 0.0877,
      "mae_dtheta": 0.012657225131988525,
      "mae_dx": 0.0018305311677977443,
      "mae_dy": 0.0019516099710017443,
      "pose_mae_dtheta": 0.08660069853067398,
      "pose_mae_dx": 0.023076999932527542,
      "pose_mae_dy": 0.0296493973582983,
      "pose_rmse_dtheta": 0.23069514334201813,
      "pose_rmse_dx": 0.05569484084844589,
      "pose_rmse_dy": 0.07065070420503616,
      "pose_rmse_mean": 0.11901356279850006,
      "rmse_dtheta": 0.028950834646821022,
      "rmse_dx": 0.00576099194586277,
      "rmse_dy": 0.003984109032899141,
      "rmse_mean": 0.012898645363748074,
      "rotation_flip": 0.0024479804560542107,
      "sparse_tokens": 32089.0,
      "step": 10546,
      "turn_loss": 0.1114283874630928,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.49001115034380227,
      "grad_norm": 0.5410022735595703,
      "learning_rate": 3.65071999512816e-07,
      "loss": 0.1182,
      "mae_dtheta": 0.028096044436097145,
      "mae_dx": 0.009425097145140171,
      "mae_dy": 0.00544928340241313,
      "pose_mae_dtheta": 0.20042292773723602,
      "pose_mae_dx": 0.07088709622621536,
      "pose_mae_dy": 0.07045678049325943,
      "pose_rmse_dtheta": 0.361643522977829,
      "pose_rmse_dx": 0.1634606122970581,
      "pose_rmse_dy": 0.15787845849990845,
      "pose_rmse_mean": 0.2276608794927597,
      "rmse_dtheta": 0.044130027294158936,
      "rmse_dx": 0.02063518948853016,
      "rmse_dy": 0.01057000644505024,
      "rmse_mean": 0.025111740455031395,
      "rotation_flip": 0.020610056817531586,
      "sparse_tokens": 22805.0,
      "step": 10547,
      "turn_loss": 0.22100546956062317,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.49005761010964505,
      "grad_norm": 0.8596846461296082,
      "learning_rate": 3.645762012606019e-07,
      "loss": 0.177,
      "mae_dtheta": 0.031121525913476944,
      "mae_dx": 0.010298480279743671,
      "mae_dy": 0.003946192096918821,
      "pose_mae_dtheta": 0.26728230714797974,
      "pose_mae_dx": 0.07650116086006165,
      "pose_mae_dy": 0.05255119130015373,
      "pose_rmse_dtheta": 0.4246504306793213,
      "pose_rmse_dx": 0.1680212914943695,
      "pose_rmse_dy": 0.12063878774642944,
      "pose_rmse_mean": 0.2377701848745346,
      "rmse_dtheta": 0.0460452139377594,
      "rmse_dx": 0.021754959598183632,
      "rmse_dy": 0.007605514023452997,
      "rmse_mean": 0.025135230273008347,
      "rotation_flip": 0.00554528646171093,
      "sparse_tokens": 8918.0,
      "step": 10548,
      "turn_loss": 0.26101958751678467,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4901040698754878,
      "grad_norm": 0.5681119561195374,
      "learning_rate": 3.6408072716606346e-07,
      "loss": 0.127,
      "mae_dtheta": 0.010922295041382313,
      "mae_dx": 0.002138537587597966,
      "mae_dy": 0.0024906860198825598,
      "pose_mae_dtheta": 0.07872908562421799,
      "pose_mae_dx": 0.023075418546795845,
      "pose_mae_dy": 0.026003142818808556,
      "pose_rmse_dtheta": 0.21947027742862701,
      "pose_rmse_dx": 0.07087007164955139,
      "pose_rmse_dy": 0.06521031260490417,
      "pose_rmse_mean": 0.11851689219474792,
      "rmse_dtheta": 0.02527020126581192,
      "rmse_dx": 0.007218892686069012,
      "rmse_dy": 0.006719103083014488,
      "rmse_mean": 0.013069398701190948,
      "rotation_flip": 0.00790349394083023,
      "sparse_tokens": 32073.0,
      "step": 10549,
      "turn_loss": 0.09847919642925262,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4901505296413306,
      "grad_norm": 0.3819431662559509,
      "learning_rate": 3.6358557726384694e-07,
      "loss": 0.088,
      "mae_dtheta": 0.012392502278089523,
      "mae_dx": 0.001999368192628026,
      "mae_dy": 0.0027787492144852877,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3819432258605957,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.62750244140625,
      "model/head/act_norm_mean": 101.03246330492425,
      "model/head/act_norm_min": 57.574031829833984,
      "model/head/act_over_embed": 69.430454663968,
      "model/head/grad_frac": 0.12387172877788544,
      "model/head/grad_norm": 0.047311969101428986,
      "model/head/grad_zero_frac": 0.0001675194944255054,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7049745501893939,
      "model/head/update_ratio": 0.0008054085774347186,
      "model/head/weight_delta": 9.971439361572266,
      "model/head/weight_delta_rel": 0.17492857575416565,
      "model/head/weight_norm": 58.74281692504883,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.422886461019516,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228046123798077,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4226965606212616,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29055528798654995,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10327253490686417,
      "model/modality_embedder.encoders.pose/grad_norm": 0.039444245398044586,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5213518099547512,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001273628557100892,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1540966033935547,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10305416584014893,
      "model/modality_embedder.encoders.pose/weight_norm": 30.9699764251709,
      "model/modality_embedder/grad_frac": 0.10327253490686417,
      "model/modality_embedder/grad_norm": 0.039444245398044586,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5213518099547512,
      "model/modality_embedder/update_ratio": 0.001273628557100892,
      "model/modality_embedder/weight_delta": 3.1540966033935547,
      "model/modality_embedder/weight_delta_rel": 0.10305416584014893,
      "model/modality_embedder/weight_norm": 30.9699764251709,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.5584945678711,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.77632726070226,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.986640930175781,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.652105328889986,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07378674298524857,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.028182346373796463,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010079682106152177,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.734997510910034,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09966495633125305,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.959558486938477,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.23623657226562,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.706589706589707,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.44441032409668,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.291390390958075,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07507307082414627,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.028673650696873665,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009632328292354941,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4674954414367676,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12011675536632538,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76814079284668,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.31795501708984,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.508387445887447,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.933589935302734,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.529602666099688,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06881950795650482,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.026285143569111824,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008550907368771732,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7564470767974854,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12613445520401,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.739595413208008,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.1161880493164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.2821794332211,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.62177848815918,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.748569126297596,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06404191255569458,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02446037344634533,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008166225161403418,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2281129360198975,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11032158136367798,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.953096389770508,
      "model/normalizer/grad_frac": 0.24374911189079285,
      "model/normalizer/grad_norm": 0.09309832006692886,
      "model/normalizer/grad_zero_frac": 0.00019262336718384176,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0011836306657642126,
      "model/normalizer/weight_delta": 6.790309906005859,
      "model/normalizer/weight_delta_rel": 0.08745525777339935,
      "model/normalizer/weight_norm": 78.65487670898438,
      "pose_mae_dtheta": 0.07859064638614655,
      "pose_mae_dx": 0.024238398298621178,
      "pose_mae_dy": 0.027821704745292664,
      "pose_rmse_dtheta": 0.1623881310224533,
      "pose_rmse_dx": 0.06423479318618774,
      "pose_rmse_dy": 0.061063554137945175,
      "pose_rmse_mean": 0.09589549154043198,
      "rmse_dtheta": 0.02458534948527813,
      "rmse_dx": 0.006109130568802357,
      "rmse_dy": 0.006239177193492651,
      "rmse_mean": 0.012311219237744808,
      "rotation_flip": 0.006949270144104958,
      "sparse_tokens": 32089.0,
      "step": 10550,
      "turn_loss": 0.09921436756849289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36875.0,
      "epoch": 0.4901969894071734,
      "grad_norm": 0.6561669111251831,
      "learning_rate": 3.630907515885801e-07,
      "loss": 0.1374,
      "mae_dtheta": 0.035859521478414536,
      "mae_dx": 0.0092309033498168,
      "mae_dy": 0.006582727190107107,
      "pose_mae_dtheta": 0.285546213388443,
      "pose_mae_dx": 0.07795098423957825,
      "pose_mae_dy": 0.06578005105257034,
      "pose_rmse_dtheta": 0.5241416096687317,
      "pose_rmse_dx": 0.17157083749771118,
      "pose_rmse_dy": 0.1497497707605362,
      "pose_rmse_mean": 0.28182074427604675,
      "rmse_dtheta": 0.05562514439225197,
      "rmse_dx": 0.01993083395063877,
      "rmse_dy": 0.014262302778661251,
      "rmse_mean": 0.029939427971839905,
      "rotation_flip": 0.012273523956537247,
      "sparse_tokens": 29675.0,
      "step": 10551,
      "turn_loss": 0.31621626019477844,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 38820.0,
      "epoch": 0.49024344917301615,
      "grad_norm": 0.614727258682251,
      "learning_rate": 3.625962501748653e-07,
      "loss": 0.1646,
      "mae_dtheta": 0.035592127591371536,
      "mae_dx": 0.01402731891721487,
      "mae_dy": 0.005509420298039913,
      "pose_mae_dtheta": 0.29998406767845154,
      "pose_mae_dx": 0.1137305349111557,
      "pose_mae_dy": 0.0659896582365036,
      "pose_rmse_dtheta": 0.5264997482299805,
      "pose_rmse_dx": 0.23937222361564636,
      "pose_rmse_dy": 0.16760526597499847,
      "pose_rmse_mean": 0.3111591041088104,
      "rmse_dtheta": 0.05511753261089325,
      "rmse_dx": 0.026802418753504753,
      "rmse_dy": 0.010677175596356392,
      "rmse_mean": 0.030865710228681564,
      "rotation_flip": 0.011594203300774097,
      "sparse_tokens": 29820.0,
      "step": 10552,
      "turn_loss": 0.26745322346687317,
      "turns": 120.0,
      "turns_per_sample": 120.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.49028990893885893,
      "grad_norm": 0.4640209674835205,
      "learning_rate": 3.621020730572844e-07,
      "loss": 0.0955,
      "mae_dtheta": 0.008162545040249825,
      "mae_dx": 0.0013387675862759352,
      "mae_dy": 0.0009693498141132295,
      "pose_mae_dtheta": 0.059042368084192276,
      "pose_mae_dx": 0.011654906906187534,
      "pose_mae_dy": 0.01415327750146389,
      "pose_rmse_dtheta": 0.2198227345943451,
      "pose_rmse_dx": 0.03742410987615585,
      "pose_rmse_dy": 0.0422808974981308,
      "pose_rmse_mean": 0.09984259307384491,
      "rmse_dtheta": 0.02515590377151966,
      "rmse_dx": 0.004818899091333151,
      "rmse_dy": 0.0031124160159379244,
      "rmse_mean": 0.011029073968529701,
      "rotation_flip": 0.005850804504007101,
      "sparse_tokens": 32153.0,
      "step": 10553,
      "turn_loss": 0.05197182670235634,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.4903363687047017,
      "grad_norm": 1.2410502433776855,
      "learning_rate": 3.616082202703941e-07,
      "loss": 0.2534,
      "mae_dtheta": 0.03139382228255272,
      "mae_dx": 0.011136672459542751,
      "mae_dy": 0.0032265351619571447,
      "pose_mae_dtheta": 0.24247927963733673,
      "pose_mae_dx": 0.07225964218378067,
      "pose_mae_dy": 0.0485415942966938,
      "pose_rmse_dtheta": 0.4621729254722595,
      "pose_rmse_dx": 0.1574711948633194,
      "pose_rmse_dy": 0.12516191601753235,
      "pose_rmse_mean": 0.24826869368553162,
      "rmse_dtheta": 0.05064815655350685,
      "rmse_dx": 0.02315545082092285,
      "rmse_dy": 0.006828465033322573,
      "rmse_mean": 0.026877356693148613,
      "rotation_flip": 0.01944444514811039,
      "sparse_tokens": 6621.0,
      "step": 10554,
      "turn_loss": 0.20463329553604126,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 27817.0,
      "epoch": 0.4903828284705445,
      "grad_norm": 0.7672186493873596,
      "learning_rate": 3.611146918487307e-07,
      "loss": 0.1802,
      "mae_dtheta": 0.04007422924041748,
      "mae_dx": 0.010934729129076004,
      "mae_dy": 0.003604161087423563,
      "pose_mae_dtheta": 0.3416765630245209,
      "pose_mae_dx": 0.09557630866765976,
      "pose_mae_dy": 0.04543448984622955,
      "pose_rmse_dtheta": 0.5695997476577759,
      "pose_rmse_dx": 0.21502359211444855,
      "pose_rmse_dy": 0.11235187947750092,
      "pose_rmse_mean": 0.29899173974990845,
      "rmse_dtheta": 0.0588613823056221,
      "rmse_dx": 0.02323673851788044,
      "rmse_dy": 0.007636270485818386,
      "rmse_mean": 0.0299114640802145,
      "rotation_flip": 0.014827017672359943,
      "sparse_tokens": 20260.0,
      "step": 10555,
      "turn_loss": 0.2746802568435669,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.49042928823638726,
      "grad_norm": 0.5833925604820251,
      "learning_rate": 3.606214878268077e-07,
      "loss": 0.1007,
      "mae_dtheta": 0.006925495807081461,
      "mae_dx": 0.001316828653216362,
      "mae_dy": 0.0014503046404570341,
      "pose_mae_dtheta": 0.04492047801613808,
      "pose_mae_dx": 0.014800235629081726,
      "pose_mae_dy": 0.016182392835617065,
      "pose_rmse_dtheta": 0.1399613469839096,
      "pose_rmse_dx": 0.043596137315034866,
      "pose_rmse_dy": 0.03997524827718735,
      "pose_rmse_mean": 0.07451091706752777,
      "rmse_dtheta": 0.018974820151925087,
      "rmse_dx": 0.004106978420168161,
      "rmse_dy": 0.003568274201825261,
      "rmse_mean": 0.008883357979357243,
      "rotation_flip": 0.0024559968151152134,
      "sparse_tokens": 32169.0,
      "step": 10556,
      "turn_loss": 0.05176323652267456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4904757480022301,
      "grad_norm": 0.41723182797431946,
      "learning_rate": 3.6012860823911313e-07,
      "loss": 0.0776,
      "mae_dtheta": 0.006181105971336365,
      "mae_dx": 0.001191075425595045,
      "mae_dy": 0.0013391018146649003,
      "pose_mae_dtheta": 0.04083377867937088,
      "pose_mae_dx": 0.012179051525890827,
      "pose_mae_dy": 0.014634774997830391,
      "pose_rmse_dtheta": 0.12224192917346954,
      "pose_rmse_dx": 0.029468512162566185,
      "pose_rmse_dy": 0.03846228867769241,
      "pose_rmse_mean": 0.06339091062545776,
      "rmse_dtheta": 0.016891490668058395,
      "rmse_dx": 0.003544909181073308,
      "rmse_dy": 0.0029518234077841043,
      "rmse_mean": 0.007796074729412794,
      "rotation_flip": 0.0019500779453665018,
      "sparse_tokens": 32185.0,
      "step": 10557,
      "turn_loss": 0.04917018488049507,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.49052220776807287,
      "grad_norm": 0.3148852288722992,
      "learning_rate": 3.59636053120116e-07,
      "loss": 0.0641,
      "mae_dtheta": 0.03568737953901291,
      "mae_dx": 0.007287161890417337,
      "mae_dy": 0.004562366753816605,
      "pose_mae_dtheta": 0.2662237286567688,
      "pose_mae_dx": 0.061059676110744476,
      "pose_mae_dy": 0.04047398269176483,
      "pose_rmse_dtheta": 0.459789901971817,
      "pose_rmse_dx": 0.14620159566402435,
      "pose_rmse_dy": 0.10357077419757843,
      "pose_rmse_mean": 0.23652075231075287,
      "rmse_dtheta": 0.05261455476284027,
      "rmse_dx": 0.016217632219195366,
      "rmse_dy": 0.010526653379201889,
      "rmse_mean": 0.02645294927060604,
      "rotation_flip": 0.01116427406668663,
      "sparse_tokens": 10065.0,
      "step": 10558,
      "turn_loss": 0.2858477532863617,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.49056866753391565,
      "grad_norm": 0.6409791111946106,
      "learning_rate": 3.5914382250425927e-07,
      "loss": 0.1135,
      "mae_dtheta": 0.010433601215481758,
      "mae_dx": 0.001783058512955904,
      "mae_dy": 0.0025144859682768583,
      "pose_mae_dtheta": 0.07519065588712692,
      "pose_mae_dx": 0.023260746151208878,
      "pose_mae_dy": 0.02194305881857872,
      "pose_rmse_dtheta": 0.24218662083148956,
      "pose_rmse_dx": 0.06814711540937424,
      "pose_rmse_dy": 0.0482790507376194,
      "pose_rmse_mean": 0.1195375919342041,
      "rmse_dtheta": 0.02548077516257763,
      "rmse_dx": 0.004996521398425102,
      "rmse_dy": 0.00553005188703537,
      "rmse_mean": 0.012002449482679367,
      "rotation_flip": 0.002694380236789584,
      "sparse_tokens": 32089.0,
      "step": 10559,
      "turn_loss": 0.07434733957052231,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4906151272997584,
      "grad_norm": 0.5337626934051514,
      "learning_rate": 3.586519164259672e-07,
      "loss": 0.1077,
      "mae_dtheta": 0.008740243501961231,
      "mae_dx": 0.0019285880262032151,
      "mae_dy": 0.0025316013488918543,
      "pose_mae_dtheta": 0.05575206130743027,
      "pose_mae_dx": 0.023430928587913513,
      "pose_mae_dy": 0.021496932953596115,
      "pose_rmse_dtheta": 0.1470152586698532,
      "pose_rmse_dx": 0.07968299835920334,
      "pose_rmse_dy": 0.0486210398375988,
      "pose_rmse_mean": 0.09177309274673462,
      "rmse_dtheta": 0.021020924672484398,
      "rmse_dx": 0.006227388512343168,
      "rmse_dy": 0.0070325275883078575,
      "rmse_mean": 0.011426947079598904,
      "rotation_flip": 0.002946593100205064,
      "sparse_tokens": 32137.0,
      "step": 10560,
      "turn_loss": 0.07172032445669174,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.4906615870656012,
      "grad_norm": 0.7569364309310913,
      "learning_rate": 3.581603349196372e-07,
      "loss": 0.1537,
      "mae_dtheta": 0.03290777653455734,
      "mae_dx": 0.009994019754230976,
      "mae_dy": 0.004828836303204298,
      "pose_mae_dtheta": 0.2539979815483093,
      "pose_mae_dx": 0.06274053454399109,
      "pose_mae_dy": 0.06840813905000687,
      "pose_rmse_dtheta": 0.4242219030857086,
      "pose_rmse_dx": 0.1403534710407257,
      "pose_rmse_dy": 0.16911563277244568,
      "pose_rmse_mean": 0.24456366896629333,
      "rmse_dtheta": 0.04899011179804802,
      "rmse_dx": 0.02206548862159252,
      "rmse_dy": 0.008724384009838104,
      "rmse_mean": 0.026593327522277832,
      "rotation_flip": 0.013961605727672577,
      "sparse_tokens": 9619.0,
      "step": 10561,
      "turn_loss": 0.27881404757499695,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.490708046831444,
      "grad_norm": 0.4030247926712036,
      "learning_rate": 3.576690780196457e-07,
      "loss": 0.0529,
      "mae_dtheta": 0.006214780732989311,
      "mae_dx": 0.0011741808848455548,
      "mae_dy": 0.0013048299588263035,
      "pose_mae_dtheta": 0.039609644562006,
      "pose_mae_dx": 0.01231174636632204,
      "pose_mae_dy": 0.015720918774604797,
      "pose_rmse_dtheta": 0.09613972157239914,
      "pose_rmse_dx": 0.03794993832707405,
      "pose_rmse_dy": 0.0387456975877285,
      "pose_rmse_mean": 0.05761178955435753,
      "rmse_dtheta": 0.016108524054288864,
      "rmse_dx": 0.0039052588399499655,
      "rmse_dy": 0.0031939870677888393,
      "rmse_mean": 0.0077359238639473915,
      "rotation_flip": 0.006220095790922642,
      "sparse_tokens": 32105.0,
      "step": 10562,
      "turn_loss": 0.051793668419122696,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.49075450659728675,
      "grad_norm": 0.5513128638267517,
      "learning_rate": 3.5717814576034846e-07,
      "loss": 0.1045,
      "mae_dtheta": 0.008876502513885498,
      "mae_dx": 0.0019987719133496284,
      "mae_dy": 0.0023430921137332916,
      "pose_mae_dtheta": 0.0670352354645729,
      "pose_mae_dx": 0.028868352994322777,
      "pose_mae_dy": 0.02583582140505314,
      "pose_rmse_dtheta": 0.18044809997081757,
      "pose_rmse_dx": 0.08487989753484726,
      "pose_rmse_dy": 0.06581587344408035,
      "pose_rmse_mean": 0.11038129031658173,
      "rmse_dtheta": 0.021040894091129303,
      "rmse_dx": 0.006344076246023178,
      "rmse_dy": 0.005737543571740389,
      "rmse_mean": 0.011040838435292244,
      "rotation_flip": 0.0018578727031126618,
      "sparse_tokens": 32105.0,
      "step": 10563,
      "turn_loss": 0.07070979475975037,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.49080096636312953,
      "grad_norm": 0.4072202146053314,
      "learning_rate": 3.566875381760748e-07,
      "loss": 0.0976,
      "mae_dtheta": 0.004966694861650467,
      "mae_dx": 0.0009880923898890615,
      "mae_dy": 0.0008160477154888213,
      "pose_mae_dtheta": 0.03361386060714722,
      "pose_mae_dx": 0.010171781294047832,
      "pose_mae_dy": 0.0091044707223773,
      "pose_rmse_dtheta": 0.1434500366449356,
      "pose_rmse_dx": 0.02862495370209217,
      "pose_rmse_dy": 0.026453055441379547,
      "pose_rmse_mean": 0.06617601960897446,
      "rmse_dtheta": 0.017519215121865273,
      "rmse_dx": 0.0032568429596722126,
      "rmse_dy": 0.0025148787535727024,
      "rmse_mean": 0.007763645611703396,
      "rotation_flip": 0.0006191950524225831,
      "sparse_tokens": 32105.0,
      "step": 10564,
      "turn_loss": 0.0360817089676857,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 38940.0,
      "epoch": 0.4908474261289723,
      "grad_norm": 0.789779782295227,
      "learning_rate": 3.561972553011345e-07,
      "loss": 0.1722,
      "mae_dtheta": 0.033449236303567886,
      "mae_dx": 0.010561099275946617,
      "mae_dy": 0.0052313352935016155,
      "pose_mae_dtheta": 0.24836401641368866,
      "pose_mae_dx": 0.08290433138608932,
      "pose_mae_dy": 0.057028137147426605,
      "pose_rmse_dtheta": 0.4564164876937866,
      "pose_rmse_dx": 0.19221307337284088,
      "pose_rmse_dy": 0.14503520727157593,
      "pose_rmse_mean": 0.2645549178123474,
      "rmse_dtheta": 0.05300581082701683,
      "rmse_dx": 0.022439325228333473,
      "rmse_dy": 0.011851474642753601,
      "rmse_mean": 0.02909887209534645,
      "rotation_flip": 0.010520778596401215,
      "sparse_tokens": 29249.0,
      "step": 10565,
      "turn_loss": 0.25151047110557556,
      "turns": 120.0,
      "turns_per_sample": 120.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.4908938858948151,
      "grad_norm": 0.47407272458076477,
      "learning_rate": 3.5570729716981167e-07,
      "loss": 0.0565,
      "mae_dtheta": 0.01876484788954258,
      "mae_dx": 0.005363240838050842,
      "mae_dy": 0.0020930233877152205,
      "pose_mae_dtheta": 0.14337961375713348,
      "pose_mae_dx": 0.040067873895168304,
      "pose_mae_dy": 0.025256043300032616,
      "pose_rmse_dtheta": 0.26665183901786804,
      "pose_rmse_dx": 0.11523417383432388,
      "pose_rmse_dy": 0.060285307466983795,
      "pose_rmse_mean": 0.1473904401063919,
      "rmse_dtheta": 0.03197937086224556,
      "rmse_dx": 0.013923886232078075,
      "rmse_dy": 0.004010648000985384,
      "rmse_mean": 0.01663796976208687,
      "rotation_flip": 0.012376237660646439,
      "sparse_tokens": 6708.0,
      "step": 10566,
      "turn_loss": 0.12017519026994705,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.49094034566065786,
      "grad_norm": 0.36332690715789795,
      "learning_rate": 3.552176638163707e-07,
      "loss": 0.0795,
      "mae_dtheta": 0.010348600335419178,
      "mae_dx": 0.0019093394512310624,
      "mae_dy": 0.002166049089282751,
      "pose_mae_dtheta": 0.06859973073005676,
      "pose_mae_dx": 0.021138688549399376,
      "pose_mae_dy": 0.020837992429733276,
      "pose_rmse_dtheta": 0.19013215601444244,
      "pose_rmse_dx": 0.05442480742931366,
      "pose_rmse_dy": 0.04462258517742157,
      "pose_rmse_mean": 0.09639319032430649,
      "rmse_dtheta": 0.023574240505695343,
      "rmse_dx": 0.006139842793345451,
      "rmse_dy": 0.005128687713295221,
      "rmse_mean": 0.011614257469773293,
      "rotation_flip": 0.004705030936747789,
      "sparse_tokens": 32121.0,
      "step": 10567,
      "turn_loss": 0.09381934255361557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.49098680542650064,
      "grad_norm": 0.45526251196861267,
      "learning_rate": 3.547283552750519e-07,
      "loss": 0.0994,
      "mae_dtheta": 0.029030274599790573,
      "mae_dx": 0.0074074119329452515,
      "mae_dy": 0.002387985587120056,
      "pose_mae_dtheta": 0.2340618222951889,
      "pose_mae_dx": 0.06036872789263725,
      "pose_mae_dy": 0.027006004005670547,
      "pose_rmse_dtheta": 0.47366905212402344,
      "pose_rmse_dx": 0.15315891802310944,
      "pose_rmse_dy": 0.0594632662832737,
      "pose_rmse_mean": 0.22876374423503876,
      "rmse_dtheta": 0.05034526064991951,
      "rmse_dx": 0.01650034263730049,
      "rmse_dy": 0.004915884230285883,
      "rmse_mean": 0.023920496925711632,
      "rotation_flip": 0.010507880710065365,
      "sparse_tokens": 9515.0,
      "step": 10568,
      "turn_loss": 0.2123456448316574,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4910332651923434,
      "grad_norm": 0.5530884861946106,
      "learning_rate": 3.5423937158007185e-07,
      "loss": 0.1737,
      "mae_dtheta": 0.011462554335594177,
      "mae_dx": 0.0020979950204491615,
      "mae_dy": 0.0032697259448468685,
      "pose_mae_dtheta": 0.06641127169132233,
      "pose_mae_dx": 0.026015248149633408,
      "pose_mae_dy": 0.030366206541657448,
      "pose_rmse_dtheta": 0.13002116978168488,
      "pose_rmse_dx": 0.06939736008644104,
      "pose_rmse_dy": 0.06304308027029037,
      "pose_rmse_mean": 0.08748720586299896,
      "rmse_dtheta": 0.021440906450152397,
      "rmse_dx": 0.006154218222945929,
      "rmse_dy": 0.007596458308398724,
      "rmse_mean": 0.011730528436601162,
      "rotation_flip": 0.011900468729436398,
      "sparse_tokens": 32089.0,
      "step": 10569,
      "turn_loss": 0.09753510355949402,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.4910797249581862,
      "grad_norm": 0.2656269967556,
      "learning_rate": 3.53750712765627e-07,
      "loss": 0.0671,
      "mae_dtheta": 0.00788741186261177,
      "mae_dx": 0.0009469834621995687,
      "mae_dy": 0.001531642279587686,
      "pose_mae_dtheta": 0.05236775428056717,
      "pose_mae_dx": 0.015979625284671783,
      "pose_mae_dy": 0.02518092840909958,
      "pose_rmse_dtheta": 0.12207520008087158,
      "pose_rmse_dx": 0.04090423136949539,
      "pose_rmse_dy": 0.06911499798297882,
      "pose_rmse_mean": 0.07736480981111526,
      "rmse_dtheta": 0.016811702400445938,
      "rmse_dx": 0.0031506179366260767,
      "rmse_dy": 0.003397673834115267,
      "rmse_mean": 0.007786664646118879,
      "rotation_flip": 0.002248454140499234,
      "sparse_tokens": 32025.0,
      "step": 10570,
      "turn_loss": 0.06494492292404175,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.49112618472402897,
      "grad_norm": 0.4258280396461487,
      "learning_rate": 3.5326237886588734e-07,
      "loss": 0.0923,
      "mae_dtheta": 0.010819962248206139,
      "mae_dx": 0.0024910413194447756,
      "mae_dy": 0.0025960179045796394,
      "pose_mae_dtheta": 0.07297900319099426,
      "pose_mae_dx": 0.02977284975349903,
      "pose_mae_dy": 0.026588259264826775,
      "pose_rmse_dtheta": 0.215827077627182,
      "pose_rmse_dx": 0.07977324724197388,
      "pose_rmse_dy": 0.06174739450216293,
      "pose_rmse_mean": 0.11911591142416,
      "rmse_dtheta": 0.026148846372961998,
      "rmse_dx": 0.00819880235940218,
      "rmse_dy": 0.006349197123199701,
      "rmse_mean": 0.013565616682171822,
      "rotation_flip": 0.00184979650657624,
      "sparse_tokens": 32121.0,
      "step": 10571,
      "turn_loss": 0.10365373641252518,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.49117264448987175,
      "grad_norm": 0.6038294434547424,
      "learning_rate": 3.5277436991500493e-07,
      "loss": 0.0948,
      "mae_dtheta": 0.031001104041934013,
      "mae_dx": 0.01751037687063217,
      "mae_dy": 0.011190449818968773,
      "pose_mae_dtheta": 0.2176964432001114,
      "pose_mae_dx": 0.13413944840431213,
      "pose_mae_dy": 0.14041991531848907,
      "pose_rmse_dtheta": 0.3768664598464966,
      "pose_rmse_dx": 0.24817359447479248,
      "pose_rmse_dy": 0.2380494773387909,
      "pose_rmse_mean": 0.2876965403556824,
      "rmse_dtheta": 0.0464501716196537,
      "rmse_dx": 0.03083588182926178,
      "rmse_dy": 0.01743268221616745,
      "rmse_mean": 0.03157291188836098,
      "rotation_flip": 0.029069768264889717,
      "sparse_tokens": 2812.0,
      "step": 10572,
      "turn_loss": 0.374474436044693,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 28139.0,
      "epoch": 0.4912191042557146,
      "grad_norm": 0.7655766606330872,
      "learning_rate": 3.522866859471047e-07,
      "loss": 0.2522,
      "mae_dtheta": 0.04018356651067734,
      "mae_dx": 0.010092430748045444,
      "mae_dy": 0.005343926139175892,
      "pose_mae_dtheta": 0.3095669448375702,
      "pose_mae_dx": 0.08276326209306717,
      "pose_mae_dy": 0.0607304722070694,
      "pose_rmse_dtheta": 0.5658247470855713,
      "pose_rmse_dx": 0.18570426106452942,
      "pose_rmse_dy": 0.13333170115947723,
      "pose_rmse_mean": 0.2949535846710205,
      "rmse_dtheta": 0.06029239296913147,
      "rmse_dx": 0.02170756086707115,
      "rmse_dy": 0.010596070438623428,
      "rmse_mean": 0.030865341424942017,
      "rotation_flip": 0.012130402028560638,
      "sparse_tokens": 23816.0,
      "step": 10573,
      "turn_loss": 0.2796275019645691,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 6822.0,
      "epoch": 0.49126556402155735,
      "grad_norm": 0.6346369385719299,
      "learning_rate": 3.517993269962905e-07,
      "loss": 0.1313,
      "mae_dtheta": 0.030018102377653122,
      "mae_dx": 0.0180799700319767,
      "mae_dy": 0.0031067701056599617,
      "pose_mae_dtheta": 0.24861563742160797,
      "pose_mae_dx": 0.13638028502464294,
      "pose_mae_dy": 0.037266649305820465,
      "pose_rmse_dtheta": 0.4238035976886749,
      "pose_rmse_dx": 0.3017164170742035,
      "pose_rmse_dy": 0.08083798736333847,
      "pose_rmse_mean": 0.2687860131263733,
      "rmse_dtheta": 0.04725080728530884,
      "rmse_dx": 0.03249780461192131,
      "rmse_dy": 0.007604418322443962,
      "rmse_mean": 0.029117679223418236,
      "rotation_flip": 0.016778523102402687,
      "sparse_tokens": 5211.0,
      "step": 10574,
      "turn_loss": 0.365005761384964,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.49131202378740013,
      "grad_norm": 0.7979181408882141,
      "learning_rate": 3.513122930966451e-07,
      "loss": 0.1661,
      "mae_dtheta": 0.011899992823600769,
      "mae_dx": 0.004339097533375025,
      "mae_dy": 0.001376044237986207,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7979183197021484,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.6013641357422,
      "model/head/act_norm_mean": 109.82348879419192,
      "model/head/act_norm_min": 61.67278289794922,
      "model/head/act_over_embed": 75.47172968307008,
      "model/head/grad_frac": 0.1098937839269638,
      "model/head/grad_norm": 0.08768626302480698,
      "model/head/grad_zero_frac": 0.00015609771071467549,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7043531013257576,
      "model/head/update_ratio": 0.0014927112497389317,
      "model/head/weight_delta": 9.972070693969727,
      "model/head/weight_delta_rel": 0.17493966221809387,
      "model/head/weight_norm": 58.742950439453125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42288029193878174,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42281505729578717,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227319359779358,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29056246583059786,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07531046867370605,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06009160354733467,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5500477979957806,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019403236219659448,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1543469429016113,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10306234657764435,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969886779785156,
      "model/modality_embedder/grad_frac": 0.07531046867370605,
      "model/modality_embedder/grad_norm": 0.06009160354733467,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5500477979957806,
      "model/modality_embedder/update_ratio": 0.0019403236219659448,
      "model/modality_embedder/weight_delta": 3.1543469429016113,
      "model/modality_embedder/weight_delta_rel": 0.10306234657764435,
      "model/modality_embedder/weight_norm": 30.969886779785156,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.47728729248047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.61379669713003,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.974299430847168,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.22762216611554,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.11038030683994293,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0880744680762291,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.003150051459670067,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.735396385192871,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09967949241399765,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.959692001342773,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.24004364013672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.543082110790444,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.269692420959473,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.866235802490092,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09783197939395905,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07806193083524704,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.002622323576360941,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4679627418518066,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1201329380273819,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.768230438232422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.82185363769531,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.272126022126024,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.446277618408203,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.05445096592404,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09684759378433228,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.07727646827697754,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.002513901563361287,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.756969928741455,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12615200877189636,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.739654541015625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.68119049072266,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.998975368767034,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.485891342163086,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.24115800395404,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09288372099399567,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.0741136223077774,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 7.565364649053663e-05,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002474315231665969,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2286376953125,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11033951491117477,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95318603515625,
      "model/normalizer/grad_frac": 0.3957479000091553,
      "model/normalizer/grad_norm": 0.31577450037002563,
      "model/normalizer/grad_zero_frac": 0.00012171905837021768,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.004014677833765745,
      "model/normalizer/weight_delta": 6.791299343109131,
      "model/normalizer/weight_delta_rel": 0.08746800571680069,
      "model/normalizer/weight_norm": 78.6550064086914,
      "pose_mae_dtheta": 0.0859023854136467,
      "pose_mae_dx": 0.03827491030097008,
      "pose_mae_dy": 0.01803598739206791,
      "pose_rmse_dtheta": 0.2811288833618164,
      "pose_rmse_dx": 0.1033560261130333,
      "pose_rmse_dy": 0.046656422317028046,
      "pose_rmse_mean": 0.1437137871980667,
      "rmse_dtheta": 0.03341572731733322,
      "rmse_dx": 0.011596348136663437,
      "rmse_dy": 0.0031127503607422113,
      "rmse_mean": 0.01604161038994789,
      "rotation_flip": 0.004988661967217922,
      "sparse_tokens": 32217.0,
      "step": 10575,
      "turn_loss": 0.10777889937162399,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.4913584835532429,
      "grad_norm": 0.4934951663017273,
      "learning_rate": 3.5082558428222555e-07,
      "loss": 0.1001,
      "mae_dtheta": 0.040542230010032654,
      "mae_dx": 0.008929071016609669,
      "mae_dy": 0.0036900793202221394,
      "pose_mae_dtheta": 0.31456321477890015,
      "pose_mae_dx": 0.056251101195812225,
      "pose_mae_dy": 0.042672425508499146,
      "pose_rmse_dtheta": 0.5929821729660034,
      "pose_rmse_dx": 0.15360164642333984,
      "pose_rmse_dy": 0.10508286207914352,
      "pose_rmse_mean": 0.28388890624046326,
      "rmse_dtheta": 0.06469694525003433,
      "rmse_dx": 0.01979183405637741,
      "rmse_dy": 0.009291717782616615,
      "rmse_mean": 0.0312601663172245,
      "rotation_flip": 0.006329114083200693,
      "sparse_tokens": 5071.0,
      "step": 10576,
      "turn_loss": 0.22507737576961517,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 20067.0,
      "epoch": 0.4914049433190857,
      "grad_norm": 0.41112565994262695,
      "learning_rate": 3.503392005870687e-07,
      "loss": 0.1034,
      "mae_dtheta": 0.04050060361623764,
      "mae_dx": 0.012483404017984867,
      "mae_dy": 0.006336946040391922,
      "pose_mae_dtheta": 0.2900722324848175,
      "pose_mae_dx": 0.09791374951601028,
      "pose_mae_dy": 0.05779876559972763,
      "pose_rmse_dtheta": 0.5073066353797913,
      "pose_rmse_dx": 0.21038006246089935,
      "pose_rmse_dy": 0.12906399369239807,
      "pose_rmse_mean": 0.2822502553462982,
      "rmse_dtheta": 0.05948451906442642,
      "rmse_dx": 0.023886840790510178,
      "rmse_dy": 0.013716960325837135,
      "rmse_mean": 0.03236277401447296,
      "rotation_flip": 0.018248174339532852,
      "sparse_tokens": 14721.0,
      "step": 10577,
      "turn_loss": 0.3111405670642853,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.49145140308492846,
      "grad_norm": 0.7167958617210388,
      "learning_rate": 3.498531420451862e-07,
      "loss": 0.2532,
      "mae_dtheta": 0.03378479927778244,
      "mae_dx": 0.010147572495043278,
      "mae_dy": 0.0026982021518051624,
      "pose_mae_dtheta": 0.26756200194358826,
      "pose_mae_dx": 0.0739954486489296,
      "pose_mae_dy": 0.03168512135744095,
      "pose_rmse_dtheta": 0.49541693925857544,
      "pose_rmse_dx": 0.1824800819158554,
      "pose_rmse_dy": 0.08924392610788345,
      "pose_rmse_mean": 0.25571367144584656,
      "rmse_dtheta": 0.05436883121728897,
      "rmse_dx": 0.022616108879446983,
      "rmse_dy": 0.006368420552462339,
      "rmse_mean": 0.027784455567598343,
      "rotation_flip": 0.010971786454319954,
      "sparse_tokens": 23199.0,
      "step": 10578,
      "turn_loss": 0.22139547765254974,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.49149786285077124,
      "grad_norm": 0.5346086025238037,
      "learning_rate": 3.4936740869057075e-07,
      "loss": 0.087,
      "mae_dtheta": 0.008993478491902351,
      "mae_dx": 0.0013642103876918554,
      "mae_dy": 0.0016362317837774754,
      "pose_mae_dtheta": 0.054904669523239136,
      "pose_mae_dx": 0.014174104668200016,
      "pose_mae_dy": 0.020405767485499382,
      "pose_rmse_dtheta": 0.16052354872226715,
      "pose_rmse_dx": 0.040155697613954544,
      "pose_rmse_dy": 0.04439731687307358,
      "pose_rmse_mean": 0.08169218897819519,
      "rmse_dtheta": 0.021411128342151642,
      "rmse_dx": 0.004536528140306473,
      "rmse_dy": 0.0039981636218726635,
      "rmse_mean": 0.009981940500438213,
      "rotation_flip": 0.006792819127440453,
      "sparse_tokens": 32073.0,
      "step": 10579,
      "turn_loss": 0.07272101938724518,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.491544322616614,
      "grad_norm": 0.4009850025177002,
      "learning_rate": 3.4888200055718747e-07,
      "loss": 0.1179,
      "mae_dtheta": 0.043550875037908554,
      "mae_dx": 0.007796292658895254,
      "mae_dy": 0.003056134097278118,
      "pose_mae_dtheta": 0.35536983609199524,
      "pose_mae_dx": 0.05963452532887459,
      "pose_mae_dy": 0.05534437671303749,
      "pose_rmse_dtheta": 0.5536888241767883,
      "pose_rmse_dx": 0.160146564245224,
      "pose_rmse_dy": 0.16551919281482697,
      "pose_rmse_mean": 0.2931181788444519,
      "rmse_dtheta": 0.05999939143657684,
      "rmse_dx": 0.019923603162169456,
      "rmse_dy": 0.007766264956444502,
      "rmse_mean": 0.029229752719402313,
      "rotation_flip": 0.009578543715178967,
      "sparse_tokens": 8097.0,
      "step": 10580,
      "turn_loss": 0.2453673928976059,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4915907823824568,
      "grad_norm": 0.34434574842453003,
      "learning_rate": 3.48396917678982e-07,
      "loss": 0.0749,
      "mae_dtheta": 0.009276208467781544,
      "mae_dx": 0.0018783954437822104,
      "mae_dy": 0.0024808826856315136,
      "pose_mae_dtheta": 0.05792931094765663,
      "pose_mae_dx": 0.018224207684397697,
      "pose_mae_dy": 0.02070620469748974,
      "pose_rmse_dtheta": 0.1434416025876999,
      "pose_rmse_dx": 0.05254008248448372,
      "pose_rmse_dy": 0.04318111017346382,
      "pose_rmse_mean": 0.07972092926502228,
      "rmse_dtheta": 0.020013684406876564,
      "rmse_dx": 0.0061079659499228,
      "rmse_dy": 0.00734432227909565,
      "rmse_mean": 0.01115532498806715,
      "rotation_flip": 0.005979073233902454,
      "sparse_tokens": 32121.0,
      "step": 10581,
      "turn_loss": 0.08181578665971756,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.49163724214829957,
      "grad_norm": 0.5921216011047363,
      "learning_rate": 3.479121600898777e-07,
      "loss": 0.11,
      "mae_dtheta": 0.010994180105626583,
      "mae_dx": 0.0013253281358629465,
      "mae_dy": 0.0016886560479179025,
      "pose_mae_dtheta": 0.07457297295331955,
      "pose_mae_dx": 0.015362726524472237,
      "pose_mae_dy": 0.02131578139960766,
      "pose_rmse_dtheta": 0.22889085114002228,
      "pose_rmse_dx": 0.04006204754114151,
      "pose_rmse_dy": 0.047196730971336365,
      "pose_rmse_mean": 0.10538321733474731,
      "rmse_dtheta": 0.025635182857513428,
      "rmse_dx": 0.00460679130628705,
      "rmse_dy": 0.0036132505629211664,
      "rmse_mean": 0.011285075917840004,
      "rotation_flip": 0.002736512804403901,
      "sparse_tokens": 32105.0,
      "step": 10582,
      "turn_loss": 0.06891818344593048,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27254.0,
      "epoch": 0.49168370191414235,
      "grad_norm": 0.4940265119075775,
      "learning_rate": 3.474277278237725e-07,
      "loss": 0.1204,
      "mae_dtheta": 0.03259139135479927,
      "mae_dx": 0.015389053151011467,
      "mae_dy": 0.00578924547880888,
      "pose_mae_dtheta": 0.2272302210330963,
      "pose_mae_dx": 0.1266127973794937,
      "pose_mae_dy": 0.06812088936567307,
      "pose_rmse_dtheta": 0.4004417657852173,
      "pose_rmse_dx": 0.26590681076049805,
      "pose_rmse_dy": 0.1572553664445877,
      "pose_rmse_mean": 0.2745346426963806,
      "rmse_dtheta": 0.04920847341418266,
      "rmse_dx": 0.029283303767442703,
      "rmse_dy": 0.010712367482483387,
      "rmse_mean": 0.029734715819358826,
      "rotation_flip": 0.014622258022427559,
      "sparse_tokens": 22528.0,
      "step": 10583,
      "turn_loss": 0.2886887192726135,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4917301616799851,
      "grad_norm": 0.5783283114433289,
      "learning_rate": 3.4694362091454434e-07,
      "loss": 0.1364,
      "mae_dtheta": 0.010449942201375961,
      "mae_dx": 0.002583845518529415,
      "mae_dy": 0.0023200244177132845,
      "pose_mae_dtheta": 0.0752762034535408,
      "pose_mae_dx": 0.0232777651399374,
      "pose_mae_dy": 0.021710960194468498,
      "pose_rmse_dtheta": 0.2103528529405594,
      "pose_rmse_dx": 0.060358159244060516,
      "pose_rmse_dy": 0.05083939805626869,
      "pose_rmse_mean": 0.10718347132205963,
      "rmse_dtheta": 0.025661183521151543,
      "rmse_dx": 0.007499201688915491,
      "rmse_dy": 0.005761540960520506,
      "rmse_mean": 0.012973975390195847,
      "rotation_flip": 0.01145792193710804,
      "sparse_tokens": 32137.0,
      "step": 10584,
      "turn_loss": 0.09279784560203552,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34282.0,
      "epoch": 0.4917766214458279,
      "grad_norm": 0.6037000417709351,
      "learning_rate": 3.46459839396045e-07,
      "loss": 0.1242,
      "mae_dtheta": 0.03520478308200836,
      "mae_dx": 0.01278212945908308,
      "mae_dy": 0.005092156119644642,
      "pose_mae_dtheta": 0.30743804574012756,
      "pose_mae_dx": 0.09976106137037277,
      "pose_mae_dy": 0.07110300660133362,
      "pose_rmse_dtheta": 0.5136605501174927,
      "pose_rmse_dx": 0.22084029018878937,
      "pose_rmse_dy": 0.1566566824913025,
      "pose_rmse_mean": 0.2970525026321411,
      "rmse_dtheta": 0.05224798619747162,
      "rmse_dx": 0.025867821648716927,
      "rmse_dy": 0.008987721987068653,
      "rmse_mean": 0.029034510254859924,
      "rotation_flip": 0.00944032333791256,
      "sparse_tokens": 27987.0,
      "step": 10585,
      "turn_loss": 0.264656662940979,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4918230812116707,
      "grad_norm": 0.4811786711215973,
      "learning_rate": 3.4597638330210795e-07,
      "loss": 0.1095,
      "mae_dtheta": 0.008432017639279366,
      "mae_dx": 0.0012332121841609478,
      "mae_dy": 0.0019771368242800236,
      "pose_mae_dtheta": 0.05731408670544624,
      "pose_mae_dx": 0.01897864043712616,
      "pose_mae_dy": 0.025920141488313675,
      "pose_rmse_dtheta": 0.14205695688724518,
      "pose_rmse_dx": 0.050082847476005554,
      "pose_rmse_dy": 0.05954231694340706,
      "pose_rmse_mean": 0.0838940441608429,
      "rmse_dtheta": 0.018678106367588043,
      "rmse_dx": 0.003567168489098549,
      "rmse_dy": 0.004060288891196251,
      "rmse_mean": 0.008768521249294281,
      "rotation_flip": 0.0031311155762523413,
      "sparse_tokens": 32105.0,
      "step": 10586,
      "turn_loss": 0.06796349585056305,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.49186954097751345,
      "grad_norm": 0.5262812376022339,
      "learning_rate": 3.4549325266653943e-07,
      "loss": 0.155,
      "mae_dtheta": 0.03370678797364235,
      "mae_dx": 0.006374921649694443,
      "mae_dy": 0.006493494845926762,
      "pose_mae_dtheta": 0.2840273380279541,
      "pose_mae_dx": 0.03933744132518768,
      "pose_mae_dy": 0.0844477042555809,
      "pose_rmse_dtheta": 0.5023148655891418,
      "pose_rmse_dx": 0.08636219054460526,
      "pose_rmse_dy": 0.19869907200336456,
      "pose_rmse_mean": 0.2624587118625641,
      "rmse_dtheta": 0.05209893733263016,
      "rmse_dx": 0.0146784083917737,
      "rmse_dy": 0.012373155914247036,
      "rmse_mean": 0.026383502408862114,
      "rotation_flip": 0.01024590153247118,
      "sparse_tokens": 8125.0,
      "step": 10587,
      "turn_loss": 0.2042490839958191,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.49191600074335623,
      "grad_norm": 0.6425408720970154,
      "learning_rate": 3.450104475231258e-07,
      "loss": 0.175,
      "mae_dtheta": 0.037827882915735245,
      "mae_dx": 0.011540532112121582,
      "mae_dy": 0.00499526085332036,
      "pose_mae_dtheta": 0.3323288559913635,
      "pose_mae_dx": 0.1135542169213295,
      "pose_mae_dy": 0.07586419582366943,
      "pose_rmse_dtheta": 0.5178260803222656,
      "pose_rmse_dx": 0.22397416830062866,
      "pose_rmse_dy": 0.1303655356168747,
      "pose_rmse_mean": 0.29072195291519165,
      "rmse_dtheta": 0.05681018531322479,
      "rmse_dx": 0.021893644705414772,
      "rmse_dy": 0.010534632951021194,
      "rmse_mean": 0.029746156185865402,
      "rotation_flip": 0.0,
      "sparse_tokens": 4165.0,
      "step": 10588,
      "turn_loss": 0.33150121569633484,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.491962460509199,
      "grad_norm": 0.468148797750473,
      "learning_rate": 3.445279679056307e-07,
      "loss": 0.1175,
      "mae_dtheta": 0.010310305282473564,
      "mae_dx": 0.002038403879851103,
      "mae_dy": 0.002102260012179613,
      "pose_mae_dtheta": 0.06629384309053421,
      "pose_mae_dx": 0.022568071261048317,
      "pose_mae_dy": 0.02504974976181984,
      "pose_rmse_dtheta": 0.17187322676181793,
      "pose_rmse_dx": 0.05742311850190163,
      "pose_rmse_dy": 0.05976470187306404,
      "pose_rmse_mean": 0.096353679895401,
      "rmse_dtheta": 0.022874629124999046,
      "rmse_dx": 0.005896851420402527,
      "rmse_dy": 0.004721918608993292,
      "rmse_mean": 0.011164466850459576,
      "rotation_flip": 0.005102040711790323,
      "sparse_tokens": 32105.0,
      "step": 10589,
      "turn_loss": 0.09394244849681854,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.49200892027504184,
      "grad_norm": 0.5193911194801331,
      "learning_rate": 3.440458138477931e-07,
      "loss": 0.1545,
      "mae_dtheta": 0.014680437743663788,
      "mae_dx": 0.002881720196455717,
      "mae_dy": 0.0032372092828154564,
      "pose_mae_dtheta": 0.0985073447227478,
      "pose_mae_dx": 0.0313873328268528,
      "pose_mae_dy": 0.03738090395927429,
      "pose_rmse_dtheta": 0.2389654666185379,
      "pose_rmse_dx": 0.08704619109630585,
      "pose_rmse_dy": 0.09525604546070099,
      "pose_rmse_mean": 0.14042256772518158,
      "rmse_dtheta": 0.03148561343550682,
      "rmse_dx": 0.008985253050923347,
      "rmse_dy": 0.007116027642041445,
      "rmse_mean": 0.015862299129366875,
      "rotation_flip": 0.007323324680328369,
      "sparse_tokens": 32105.0,
      "step": 10590,
      "turn_loss": 0.1378111094236374,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.4920553800408846,
      "grad_norm": 0.5266472697257996,
      "learning_rate": 3.435639853833317e-07,
      "loss": 0.1195,
      "mae_dtheta": 0.039313267916440964,
      "mae_dx": 0.012390035204589367,
      "mae_dy": 0.0030674126464873552,
      "pose_mae_dtheta": 0.32093191146850586,
      "pose_mae_dx": 0.10140622407197952,
      "pose_mae_dy": 0.03463767096400261,
      "pose_rmse_dtheta": 0.5418180823326111,
      "pose_rmse_dx": 0.2344660460948944,
      "pose_rmse_dy": 0.09120559692382812,
      "pose_rmse_mean": 0.2891632318496704,
      "rmse_dtheta": 0.05723939090967178,
      "rmse_dx": 0.0254997406154871,
      "rmse_dy": 0.00682451156899333,
      "rmse_mean": 0.02985454723238945,
      "rotation_flip": 0.020083103328943253,
      "sparse_tokens": 21589.0,
      "step": 10591,
      "turn_loss": 0.28651219606399536,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.4921018398067274,
      "grad_norm": 0.5476428270339966,
      "learning_rate": 3.430824825459389e-07,
      "loss": 0.1069,
      "mae_dtheta": 0.04370942711830139,
      "mae_dx": 0.010409897193312645,
      "mae_dy": 0.004241218790411949,
      "pose_mae_dtheta": 0.3621370494365692,
      "pose_mae_dx": 0.0751403272151947,
      "pose_mae_dy": 0.034687697887420654,
      "pose_rmse_dtheta": 0.6068497896194458,
      "pose_rmse_dx": 0.1647002100944519,
      "pose_rmse_dy": 0.08483370393514633,
      "pose_rmse_mean": 0.2854612469673157,
      "rmse_dtheta": 0.06310661137104034,
      "rmse_dx": 0.02147090621292591,
      "rmse_dy": 0.009080404415726662,
      "rmse_mean": 0.031219307333230972,
      "rotation_flip": 0.02248520776629448,
      "sparse_tokens": 12678.0,
      "step": 10592,
      "turn_loss": 0.33377307653427124,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.49214829957257017,
      "grad_norm": 0.5674375891685486,
      "learning_rate": 3.426013053692878e-07,
      "loss": 0.1458,
      "mae_dtheta": 0.03309398517012596,
      "mae_dx": 0.01361087802797556,
      "mae_dy": 0.004212033934891224,
      "pose_mae_dtheta": 0.24290531873703003,
      "pose_mae_dx": 0.12065358459949493,
      "pose_mae_dy": 0.056285690516233444,
      "pose_rmse_dtheta": 0.39451226592063904,
      "pose_rmse_dx": 0.2585964798927307,
      "pose_rmse_dy": 0.13121317327022552,
      "pose_rmse_mean": 0.261440634727478,
      "rmse_dtheta": 0.04759659618139267,
      "rmse_dx": 0.027380574494600296,
      "rmse_dy": 0.007351546548306942,
      "rmse_mean": 0.02744290791451931,
      "rotation_flip": 0.023297490552067757,
      "sparse_tokens": 8926.0,
      "step": 10593,
      "turn_loss": 0.29348427057266235,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.49219475933841295,
      "grad_norm": 0.35854485630989075,
      "learning_rate": 3.421204538870282e-07,
      "loss": 0.0839,
      "mae_dtheta": 0.008453979156911373,
      "mae_dx": 0.001455669291317463,
      "mae_dy": 0.0019208956509828568,
      "pose_mae_dtheta": 0.05881372466683388,
      "pose_mae_dx": 0.018893521279096603,
      "pose_mae_dy": 0.021397611126303673,
      "pose_rmse_dtheta": 0.17255330085754395,
      "pose_rmse_dx": 0.06769153475761414,
      "pose_rmse_dy": 0.057852499186992645,
      "pose_rmse_mean": 0.09936578571796417,
      "rmse_dtheta": 0.02204585261642933,
      "rmse_dx": 0.004602447617799044,
      "rmse_dy": 0.004862257279455662,
      "rmse_mean": 0.01050351932644844,
      "rotation_flip": 0.0036264732480049133,
      "sparse_tokens": 32105.0,
      "step": 10594,
      "turn_loss": 0.0693841427564621,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4922412191042557,
      "grad_norm": 0.46403080224990845,
      "learning_rate": 3.4163992813278426e-07,
      "loss": 0.0853,
      "mae_dtheta": 0.006446426268666983,
      "mae_dx": 0.0030842542182654142,
      "mae_dy": 0.00102911121211946,
      "pose_mae_dtheta": 0.043993864208459854,
      "pose_mae_dx": 0.02818784862756729,
      "pose_mae_dy": 0.010979310609400272,
      "pose_rmse_dtheta": 0.1684536635875702,
      "pose_rmse_dx": 0.11732963472604752,
      "pose_rmse_dy": 0.035280242562294006,
      "pose_rmse_mean": 0.10702117532491684,
      "rmse_dtheta": 0.02181755006313324,
      "rmse_dx": 0.01135519053786993,
      "rmse_dy": 0.003584558144211769,
      "rmse_mean": 0.012252433225512505,
      "rotation_flip": 0.0036563072353601456,
      "sparse_tokens": 32137.0,
      "step": 10595,
      "turn_loss": 0.0745696946978569,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.4922876788700985,
      "grad_norm": 0.526408851146698,
      "learning_rate": 3.411597281401613e-07,
      "loss": 0.1533,
      "mae_dtheta": 0.02094241790473461,
      "mae_dx": 0.007071910426020622,
      "mae_dy": 0.003271274734288454,
      "pose_mae_dtheta": 0.15110614895820618,
      "pose_mae_dx": 0.045736171305179596,
      "pose_mae_dy": 0.036894042044878006,
      "pose_rmse_dtheta": 0.29173365235328674,
      "pose_rmse_dx": 0.12105407565832138,
      "pose_rmse_dy": 0.09307854622602463,
      "pose_rmse_mean": 0.16862210631370544,
      "rmse_dtheta": 0.0356396846473217,
      "rmse_dx": 0.017575306817889214,
      "rmse_dy": 0.006727553438395262,
      "rmse_mean": 0.01998084783554077,
      "rotation_flip": 0.007874015718698502,
      "sparse_tokens": 23638.0,
      "step": 10596,
      "turn_loss": 0.171513170003891,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.4923341386359413,
      "grad_norm": 0.653401255607605,
      "learning_rate": 3.406798539427386e-07,
      "loss": 0.0956,
      "mae_dtheta": 0.033657193183898926,
      "mae_dx": 0.02011047676205635,
      "mae_dy": 0.0066524287685751915,
      "pose_mae_dtheta": 0.24937117099761963,
      "pose_mae_dx": 0.1548595130443573,
      "pose_mae_dy": 0.0649508610367775,
      "pose_rmse_dtheta": 0.42992982268333435,
      "pose_rmse_dx": 0.2657754123210907,
      "pose_rmse_dy": 0.10457276552915573,
      "pose_rmse_mean": 0.26675933599472046,
      "rmse_dtheta": 0.049638375639915466,
      "rmse_dx": 0.03219674155116081,
      "rmse_dy": 0.010816792957484722,
      "rmse_mean": 0.030883971601724625,
      "rotation_flip": 0.024390242993831635,
      "sparse_tokens": 3549.0,
      "step": 10597,
      "turn_loss": 0.3180016875267029,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.49238059840178405,
      "grad_norm": 0.705834150314331,
      "learning_rate": 3.402003055740749e-07,
      "loss": 0.1848,
      "mae_dtheta": 0.04564676433801651,
      "mae_dx": 0.012163610197603703,
      "mae_dy": 0.00788564421236515,
      "pose_mae_dtheta": 0.4307211935520172,
      "pose_mae_dx": 0.10368289053440094,
      "pose_mae_dy": 0.14234955608844757,
      "pose_rmse_dtheta": 0.6271135807037354,
      "pose_rmse_dx": 0.21248552203178406,
      "pose_rmse_dy": 0.2422197014093399,
      "pose_rmse_mean": 0.36060628294944763,
      "rmse_dtheta": 0.06121579930186272,
      "rmse_dx": 0.02477760799229145,
      "rmse_dy": 0.012740803882479668,
      "rmse_mean": 0.032911404967308044,
      "rotation_flip": 0.01595744676887989,
      "sparse_tokens": 2680.0,
      "step": 10598,
      "turn_loss": 0.360196053981781,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.49242705816762683,
      "grad_norm": 0.9039363265037537,
      "learning_rate": 3.3972108306770444e-07,
      "loss": 0.1209,
      "mae_dtheta": 0.04119012504816055,
      "mae_dx": 0.012045647017657757,
      "mae_dy": 0.005260589066892862,
      "pose_mae_dtheta": 0.2952210307121277,
      "pose_mae_dx": 0.08774453401565552,
      "pose_mae_dy": 0.028381817042827606,
      "pose_rmse_dtheta": 0.4919527471065521,
      "pose_rmse_dx": 0.18838153779506683,
      "pose_rmse_dy": 0.06335903704166412,
      "pose_rmse_mean": 0.24789777398109436,
      "rmse_dtheta": 0.05841799080371857,
      "rmse_dx": 0.022526290267705917,
      "rmse_dy": 0.012333042919635773,
      "rmse_mean": 0.031092442572116852,
      "rotation_flip": 0.019438445568084717,
      "sparse_tokens": 7217.0,
      "step": 10599,
      "turn_loss": 0.30422526597976685,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4924735179334696,
      "grad_norm": 0.3682536780834198,
      "learning_rate": 3.3924218645713934e-07,
      "loss": 0.0923,
      "mae_dtheta": 0.011611869558691978,
      "mae_dx": 0.0014557245885953307,
      "mae_dy": 0.00235033524222672,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.36825376749038696,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.3719940185547,
      "model/head/act_norm_mean": 110.2882536300505,
      "model/head/act_norm_min": 63.818965911865234,
      "model/head/act_over_embed": 75.79112042946905,
      "model/head/grad_frac": 0.09983035176992416,
      "model/head/grad_norm": 0.03676290437579155,
      "model/head/grad_zero_frac": 0.00018496943812351674,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7038401594065656,
      "model/head/update_ratio": 0.0006258256617002189,
      "model/head/weight_delta": 9.972768783569336,
      "model/head/weight_delta_rel": 0.17495191097259521,
      "model/head/weight_norm": 58.7430419921875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42290329933166504,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42282430013020833,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227584898471832,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29056881759294484,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08986439555883408,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03309290111064911,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5368315972222222,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010685508605092764,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1545286178588867,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1030682846903801,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96988868713379,
      "model/modality_embedder/grad_frac": 0.08986439555883408,
      "model/modality_embedder/grad_norm": 0.03309290111064911,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5368315972222222,
      "model/modality_embedder/update_ratio": 0.0010685508605092764,
      "model/modality_embedder/weight_delta": 3.1545286178588867,
      "model/modality_embedder/weight_delta_rel": 0.1030682846903801,
      "model/modality_embedder/weight_norm": 30.96988868713379,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.83583068847656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.667450797659132,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.08385944366455,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.264493766316743,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05606210231781006,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.020645080134272575,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002975710085593164,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007383833872154355,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7358062267303467,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09969443082809448,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.9598388671875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.40947723388672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.653834976751643,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 11.923595428466797,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.9423462088633,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06052553653717041,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02228875644505024,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0003026145859621465,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007487389375455678,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.468472480773926,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1201505959033966,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.768394470214844,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.47157287597656,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.45663981080648,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 11.99484920501709,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.181250568950556,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.058670930564403534,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02160579152405262,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00030765816336497664,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007028590189293027,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7575290203094482,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1261707842350006,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.739864349365234,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.39503479003906,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.173708814333814,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.856498718261719,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.361236463627826,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05854027345776558,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.021557675674557686,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0003429632051847875,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007197067025117576,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.229184150695801,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11035819351673126,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.953418731689453,
      "model/normalizer/grad_frac": 0.19977903366088867,
      "model/normalizer/grad_norm": 0.07356937974691391,
      "model/normalizer/grad_zero_frac": 0.0003084337222389877,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0009353397181257606,
      "model/normalizer/weight_delta": 6.792346000671387,
      "model/normalizer/weight_delta_rel": 0.08748148381710052,
      "model/normalizer/weight_norm": 78.6552505493164,
      "pose_mae_dtheta": 0.07292674481868744,
      "pose_mae_dx": 0.02126992680132389,
      "pose_mae_dy": 0.026853865012526512,
      "pose_rmse_dtheta": 0.18311727046966553,
      "pose_rmse_dx": 0.04872957617044449,
      "pose_rmse_dy": 0.057536691427230835,
      "pose_rmse_mean": 0.09646117687225342,
      "rmse_dtheta": 0.025116998702287674,
      "rmse_dx": 0.0038085514679551125,
      "rmse_dy": 0.004926078487187624,
      "rmse_mean": 0.0112838763743639,
      "rotation_flip": 0.0025603510439395905,
      "sparse_tokens": 32121.0,
      "step": 10600,
      "turn_loss": 0.09548214823007584,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.4924735179334696,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30223798751831055,
      "eval_objectnav_nopose_mae_dtheta": 0.03932395204901695,
      "eval_objectnav_nopose_mae_dx": 0.0127811748534441,
      "eval_objectnav_nopose_mae_dy": 0.004935037810355425,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3102891147136688,
      "eval_objectnav_nopose_pose_mae_dx": 0.10051088035106659,
      "eval_objectnav_nopose_pose_mae_dy": 0.05597095191478729,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5253621339797974,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22318509221076965,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13225314021110535,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2936001420021057,
      "eval_objectnav_nopose_rmse_dtheta": 0.05705823004245758,
      "eval_objectnav_nopose_rmse_dx": 0.025317931547760963,
      "eval_objectnav_nopose_rmse_dy": 0.009941651485860348,
      "eval_objectnav_nopose_rmse_mean": 0.030772604048252106,
      "eval_objectnav_nopose_rotation_flip": 0.015412546694278717,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30223798751831055,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 10600
    },
    {
      "epoch": 0.4924735179334696,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27014365792274475,
      "eval_objectnav_pose_mae_dtheta": 0.03492803871631622,
      "eval_objectnav_pose_mae_dx": 0.01091818418353796,
      "eval_objectnav_pose_mae_dy": 0.004576253704726696,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2615343928337097,
      "eval_objectnav_pose_pose_mae_dx": 0.08552328497171402,
      "eval_objectnav_pose_pose_mae_dy": 0.04781089723110199,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46200090646743774,
      "eval_objectnav_pose_pose_rmse_dx": 0.19921036064624786,
      "eval_objectnav_pose_pose_rmse_dy": 0.1168811097741127,
      "eval_objectnav_pose_pose_rmse_mean": 0.25936412811279297,
      "eval_objectnav_pose_rmse_dtheta": 0.05291930213570595,
      "eval_objectnav_pose_rmse_dx": 0.022965772077441216,
      "eval_objectnav_pose_rmse_dy": 0.009717719629406929,
      "eval_objectnav_pose_rmse_mean": 0.028534263372421265,
      "eval_objectnav_pose_rotation_flip": 0.01426488533616066,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27014365792274475,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 10600
    },
    {
      "epoch": 0.4924735179334696,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08703255653381348,
      "eval_pointnav_mae_dtheta": 0.010130959562957287,
      "eval_pointnav_mae_dx": 0.002185909543186426,
      "eval_pointnav_mae_dy": 0.0023463002871721983,
      "eval_pointnav_pose_mae_dtheta": 0.06905815750360489,
      "eval_pointnav_pose_mae_dx": 0.024398580193519592,
      "eval_pointnav_pose_mae_dy": 0.024264736101031303,
      "eval_pointnav_pose_rmse_dtheta": 0.2023562341928482,
      "eval_pointnav_pose_rmse_dx": 0.07592234760522842,
      "eval_pointnav_pose_rmse_dy": 0.0701613649725914,
      "eval_pointnav_pose_rmse_mean": 0.11614665389060974,
      "eval_pointnav_rmse_dtheta": 0.02536274492740631,
      "eval_pointnav_rmse_dx": 0.007060897536575794,
      "eval_pointnav_rmse_dy": 0.006353967823088169,
      "eval_pointnav_rmse_mean": 0.012925869785249233,
      "eval_pointnav_rotation_flip": 0.0050949715077877045,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08703255653381348,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 10600
    },
    {
      "epoch": 0.4924735179334696,
      "eval_loss": 0.21980473399162292,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30223798751831055,
      "eval_objectnav_nopose_mae_dtheta": 0.03932395204901695,
      "eval_objectnav_nopose_mae_dx": 0.0127811748534441,
      "eval_objectnav_nopose_mae_dy": 0.004935037810355425,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3102891147136688,
      "eval_objectnav_nopose_pose_mae_dx": 0.10051088035106659,
      "eval_objectnav_nopose_pose_mae_dy": 0.05597095191478729,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5253621339797974,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22318509221076965,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13225314021110535,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2936001420021057,
      "eval_objectnav_nopose_rmse_dtheta": 0.05705823004245758,
      "eval_objectnav_nopose_rmse_dx": 0.025317931547760963,
      "eval_objectnav_nopose_rmse_dy": 0.009941651485860348,
      "eval_objectnav_nopose_rmse_mean": 0.030772604048252106,
      "eval_objectnav_nopose_rotation_flip": 0.015412546694278717,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30223798751831055,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27014365792274475,
      "eval_objectnav_pose_mae_dtheta": 0.03492803871631622,
      "eval_objectnav_pose_mae_dx": 0.01091818418353796,
      "eval_objectnav_pose_mae_dy": 0.004576253704726696,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2615343928337097,
      "eval_objectnav_pose_pose_mae_dx": 0.08552328497171402,
      "eval_objectnav_pose_pose_mae_dy": 0.04781089723110199,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46200090646743774,
      "eval_objectnav_pose_pose_rmse_dx": 0.19921036064624786,
      "eval_objectnav_pose_pose_rmse_dy": 0.1168811097741127,
      "eval_objectnav_pose_pose_rmse_mean": 0.25936412811279297,
      "eval_objectnav_pose_rmse_dtheta": 0.05291930213570595,
      "eval_objectnav_pose_rmse_dx": 0.022965772077441216,
      "eval_objectnav_pose_rmse_dy": 0.009717719629406929,
      "eval_objectnav_pose_rmse_mean": 0.028534263372421265,
      "eval_objectnav_pose_rotation_flip": 0.01426488533616066,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27014365792274475,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08703255653381348,
      "eval_pointnav_mae_dtheta": 0.010130959562957287,
      "eval_pointnav_mae_dx": 0.002185909543186426,
      "eval_pointnav_mae_dy": 0.0023463002871721983,
      "eval_pointnav_pose_mae_dtheta": 0.06905815750360489,
      "eval_pointnav_pose_mae_dx": 0.024398580193519592,
      "eval_pointnav_pose_mae_dy": 0.024264736101031303,
      "eval_pointnav_pose_rmse_dtheta": 0.2023562341928482,
      "eval_pointnav_pose_rmse_dx": 0.07592234760522842,
      "eval_pointnav_pose_rmse_dy": 0.0701613649725914,
      "eval_pointnav_pose_rmse_mean": 0.11614665389060974,
      "eval_pointnav_rmse_dtheta": 0.02536274492740631,
      "eval_pointnav_rmse_dx": 0.007060897536575794,
      "eval_pointnav_rmse_dy": 0.006353967823088169,
      "eval_pointnav_rmse_mean": 0.012925869785249233,
      "eval_pointnav_rotation_flip": 0.0050949715077877045,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08703255653381348,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 10600
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.4925199776993124,
      "grad_norm": 0.309731662273407,
      "learning_rate": 3.3876361577587115e-07,
      "loss": 0.0772,
      "mae_dtheta": 0.03286909684538841,
      "mae_dx": 0.006549173034727573,
      "mae_dy": 0.0025659396778792143,
      "pose_mae_dtheta": 0.2989991307258606,
      "pose_mae_dx": 0.05947306007146835,
      "pose_mae_dy": 0.030535988509655,
      "pose_rmse_dtheta": 0.5312344431877136,
      "pose_rmse_dx": 0.12727735936641693,
      "pose_rmse_dy": 0.07509717345237732,
      "pose_rmse_mean": 0.24453632533550262,
      "rmse_dtheta": 0.05176609382033348,
      "rmse_dx": 0.015453181229531765,
      "rmse_dy": 0.0058110784739255905,
      "rmse_mean": 0.024343451485037804,
      "rotation_flip": 0.015719467774033546,
      "sparse_tokens": 13357.0,
      "step": 10601,
      "turn_loss": 0.2036903202533722,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.49256643746515516,
      "grad_norm": 0.48897138237953186,
      "learning_rate": 3.382853710573641e-07,
      "loss": 0.0892,
      "mae_dtheta": 0.035646598786115646,
      "mae_dx": 0.00891084037721157,
      "mae_dy": 0.0031033046543598175,
      "pose_mae_dtheta": 0.27195894718170166,
      "pose_mae_dx": 0.06068730354309082,
      "pose_mae_dy": 0.035547833889722824,
      "pose_rmse_dtheta": 0.4980018436908722,
      "pose_rmse_dx": 0.13768576085567474,
      "pose_rmse_dy": 0.1014198288321495,
      "pose_rmse_mean": 0.24570247530937195,
      "rmse_dtheta": 0.05366826429963112,
      "rmse_dx": 0.01946330815553665,
      "rmse_dy": 0.0069005368277430534,
      "rmse_mean": 0.026677370071411133,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 11074.0,
      "step": 10602,
      "turn_loss": 0.2672443389892578,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.49261289723099794,
      "grad_norm": 0.47989973425865173,
      "learning_rate": 3.3780745233506384e-07,
      "loss": 0.1127,
      "mae_dtheta": 0.020168140530586243,
      "mae_dx": 0.0036244583316147327,
      "mae_dy": 0.003285603830590844,
      "pose_mae_dtheta": 0.135296031832695,
      "pose_mae_dx": 0.03690201789140701,
      "pose_mae_dy": 0.05328146368265152,
      "pose_rmse_dtheta": 0.2625754177570343,
      "pose_rmse_dx": 0.09306643903255463,
      "pose_rmse_dy": 0.14334547519683838,
      "pose_rmse_mean": 0.16632911562919617,
      "rmse_dtheta": 0.03591707721352577,
      "rmse_dx": 0.010839685797691345,
      "rmse_dy": 0.007344035431742668,
      "rmse_mean": 0.018033599480986595,
      "rotation_flip": 0.005797101650387049,
      "sparse_tokens": 8738.0,
      "step": 10603,
      "turn_loss": 0.1119856908917427,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.4926593569968407,
      "grad_norm": 0.4660058617591858,
      "learning_rate": 3.373298596423902e-07,
      "loss": 0.1238,
      "mae_dtheta": 0.030294615775346756,
      "mae_dx": 0.007969154044985771,
      "mae_dy": 0.004085065331310034,
      "pose_mae_dtheta": 0.23568150401115417,
      "pose_mae_dx": 0.0665208026766777,
      "pose_mae_dy": 0.054246969521045685,
      "pose_rmse_dtheta": 0.4332360029220581,
      "pose_rmse_dx": 0.15337491035461426,
      "pose_rmse_dy": 0.1139359176158905,
      "pose_rmse_mean": 0.23351562023162842,
      "rmse_dtheta": 0.04859628155827522,
      "rmse_dx": 0.0179634727537632,
      "rmse_dy": 0.00789780355989933,
      "rmse_mean": 0.024819185957312584,
      "rotation_flip": 0.014446227811276913,
      "sparse_tokens": 10570.0,
      "step": 10604,
      "turn_loss": 0.2687581181526184,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4927058167626835,
      "grad_norm": 0.3676701784133911,
      "learning_rate": 3.3685259301274307e-07,
      "loss": 0.0993,
      "mae_dtheta": 0.007904205471277237,
      "mae_dx": 0.0011710148537531495,
      "mae_dy": 0.0019450938561931252,
      "pose_mae_dtheta": 0.05191926658153534,
      "pose_mae_dx": 0.014032590202987194,
      "pose_mae_dy": 0.020610671490430832,
      "pose_rmse_dtheta": 0.13974659144878387,
      "pose_rmse_dx": 0.029593389481306076,
      "pose_rmse_dy": 0.044901043176651,
      "pose_rmse_mean": 0.07141368091106415,
      "rmse_dtheta": 0.017325226217508316,
      "rmse_dx": 0.0034869927912950516,
      "rmse_dy": 0.004877075552940369,
      "rmse_mean": 0.00856309849768877,
      "rotation_flip": 0.0013284622691571712,
      "sparse_tokens": 32153.0,
      "step": 10605,
      "turn_loss": 0.05790797993540764,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4927522765285263,
      "grad_norm": 0.6503541469573975,
      "learning_rate": 3.363756524794959e-07,
      "loss": 0.0959,
      "mae_dtheta": 0.010577792301774025,
      "mae_dx": 0.0016312901861965656,
      "mae_dy": 0.002275350969284773,
      "pose_mae_dtheta": 0.06687619537115097,
      "pose_mae_dx": 0.01860055886209011,
      "pose_mae_dy": 0.02462995983660221,
      "pose_rmse_dtheta": 0.1799418181180954,
      "pose_rmse_dx": 0.04357750341296196,
      "pose_rmse_dy": 0.06199412792921066,
      "pose_rmse_mean": 0.09517115354537964,
      "rmse_dtheta": 0.024543048813939095,
      "rmse_dx": 0.004505255725234747,
      "rmse_dy": 0.005668616387993097,
      "rmse_mean": 0.011572307907044888,
      "rotation_flip": 0.0041856924071908,
      "sparse_tokens": 32137.0,
      "step": 10606,
      "turn_loss": 0.09219272434711456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4927987362943691,
      "grad_norm": 0.5992825627326965,
      "learning_rate": 3.3589903807600245e-07,
      "loss": 0.1099,
      "mae_dtheta": 0.0045676990412175655,
      "mae_dx": 0.0007003349019214511,
      "mae_dy": 0.001011301064863801,
      "pose_mae_dtheta": 0.031921327114105225,
      "pose_mae_dx": 0.008115987293422222,
      "pose_mae_dy": 0.013369104824960232,
      "pose_rmse_dtheta": 0.1064845398068428,
      "pose_rmse_dx": 0.02735990658402443,
      "pose_rmse_dy": 0.043200403451919556,
      "pose_rmse_mean": 0.059014953672885895,
      "rmse_dtheta": 0.014153335243463516,
      "rmse_dx": 0.002561175264418125,
      "rmse_dy": 0.0029903226532042027,
      "rmse_mean": 0.006568277254700661,
      "rotation_flip": 0.004222378600388765,
      "sparse_tokens": 32041.0,
      "step": 10607,
      "turn_loss": 0.03689301013946533,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.4928451960602119,
      "grad_norm": 0.8774198293685913,
      "learning_rate": 3.3542274983559333e-07,
      "loss": 0.2553,
      "mae_dtheta": 0.0313711017370224,
      "mae_dx": 0.011581877246499062,
      "mae_dy": 0.00546755688264966,
      "pose_mae_dtheta": 0.24609282612800598,
      "pose_mae_dx": 0.08525044471025467,
      "pose_mae_dy": 0.0715683102607727,
      "pose_rmse_dtheta": 0.43087416887283325,
      "pose_rmse_dx": 0.1861395686864853,
      "pose_rmse_dy": 0.16174720227718353,
      "pose_rmse_mean": 0.25958698987960815,
      "rmse_dtheta": 0.048230744898319244,
      "rmse_dx": 0.02395535819232464,
      "rmse_dy": 0.009772779420018196,
      "rmse_mean": 0.02731962874531746,
      "rotation_flip": 0.0057142856530845165,
      "sparse_tokens": 16071.0,
      "step": 10608,
      "turn_loss": 0.24154366552829742,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.49289165582605465,
      "grad_norm": 0.35809850692749023,
      "learning_rate": 3.3494678779157464e-07,
      "loss": 0.0689,
      "mae_dtheta": 0.007140804082155228,
      "mae_dx": 0.001262592850252986,
      "mae_dy": 0.0017860726220533252,
      "pose_mae_dtheta": 0.05011286586523056,
      "pose_mae_dx": 0.017672766000032425,
      "pose_mae_dy": 0.022587984800338745,
      "pose_rmse_dtheta": 0.10757861286401749,
      "pose_rmse_dx": 0.05042142793536186,
      "pose_rmse_dy": 0.04864397272467613,
      "pose_rmse_mean": 0.06888134032487869,
      "rmse_dtheta": 0.014906186610460281,
      "rmse_dx": 0.0044981930404901505,
      "rmse_dy": 0.0038766046054661274,
      "rmse_mean": 0.0077603282406926155,
      "rotation_flip": 0.0026455025654286146,
      "sparse_tokens": 32089.0,
      "step": 10609,
      "turn_loss": 0.06160086765885353,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.49293811559189743,
      "grad_norm": 0.7090851068496704,
      "learning_rate": 3.3447115197723144e-07,
      "loss": 0.1387,
      "mae_dtheta": 0.04551113024353981,
      "mae_dx": 0.01367961522191763,
      "mae_dy": 0.007517514284700155,
      "pose_mae_dtheta": 0.40514475107192993,
      "pose_mae_dx": 0.08879988640546799,
      "pose_mae_dy": 0.10416889190673828,
      "pose_rmse_dtheta": 0.6385323405265808,
      "pose_rmse_dx": 0.19043441116809845,
      "pose_rmse_dy": 0.20888417959213257,
      "pose_rmse_mean": 0.34595030546188354,
      "rmse_dtheta": 0.06494788080453873,
      "rmse_dx": 0.026314953342080116,
      "rmse_dy": 0.013583793304860592,
      "rmse_mean": 0.03494887799024582,
      "rotation_flip": 0.01666666753590107,
      "sparse_tokens": 4026.0,
      "step": 10610,
      "turn_loss": 0.4034886658191681,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4929845753577402,
      "grad_norm": 0.4184492230415344,
      "learning_rate": 3.3399584242582496e-07,
      "loss": 0.1167,
      "mae_dtheta": 0.0086288433521986,
      "mae_dx": 0.0013926769606769085,
      "mae_dy": 0.0016958311898633838,
      "pose_mae_dtheta": 0.051344722509384155,
      "pose_mae_dx": 0.015287603251636028,
      "pose_mae_dy": 0.018637007102370262,
      "pose_rmse_dtheta": 0.164886936545372,
      "pose_rmse_dx": 0.03410014882683754,
      "pose_rmse_dy": 0.04528076574206352,
      "pose_rmse_mean": 0.08142261952161789,
      "rmse_dtheta": 0.021796489134430885,
      "rmse_dx": 0.004004341084510088,
      "rmse_dy": 0.004320807754993439,
      "rmse_mean": 0.010040545836091042,
      "rotation_flip": 0.006590509787201881,
      "sparse_tokens": 32105.0,
      "step": 10611,
      "turn_loss": 0.08575643599033356,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.493031035123583,
      "grad_norm": 0.3530904948711395,
      "learning_rate": 3.335208591705924e-07,
      "loss": 0.0575,
      "mae_dtheta": 0.006736040581017733,
      "mae_dx": 0.0012826898600906134,
      "mae_dy": 0.0012338066007941961,
      "pose_mae_dtheta": 0.04501791670918465,
      "pose_mae_dx": 0.012468806467950344,
      "pose_mae_dy": 0.015424594283103943,
      "pose_rmse_dtheta": 0.15645670890808105,
      "pose_rmse_dx": 0.029910806566476822,
      "pose_rmse_dy": 0.03863348066806793,
      "pose_rmse_mean": 0.0750003308057785,
      "rmse_dtheta": 0.019031250849366188,
      "rmse_dx": 0.003886372083798051,
      "rmse_dy": 0.00313887232914567,
      "rmse_mean": 0.008685498498380184,
      "rotation_flip": 0.0026223775930702686,
      "sparse_tokens": 32169.0,
      "step": 10612,
      "turn_loss": 0.056096356362104416,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.49307749488942576,
      "grad_norm": 0.4120487868785858,
      "learning_rate": 3.3304620224475173e-07,
      "loss": 0.0896,
      "mae_dtheta": 0.006875728257000446,
      "mae_dx": 0.001150775235146284,
      "mae_dy": 0.0014164308086037636,
      "pose_mae_dtheta": 0.04456004127860069,
      "pose_mae_dx": 0.013005276210606098,
      "pose_mae_dy": 0.015044699423015118,
      "pose_rmse_dtheta": 0.11297424882650375,
      "pose_rmse_dx": 0.03259081766009331,
      "pose_rmse_dy": 0.0378950834274292,
      "pose_rmse_mean": 0.06115338206291199,
      "rmse_dtheta": 0.01780010014772415,
      "rmse_dx": 0.003238049102947116,
      "rmse_dy": 0.0032607074826955795,
      "rmse_mean": 0.008099619299173355,
      "rotation_flip": 0.0013094719033688307,
      "sparse_tokens": 32153.0,
      "step": 10613,
      "turn_loss": 0.05930918827652931,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.49312395465526854,
      "grad_norm": 0.5512630343437195,
      "learning_rate": 3.3257187168149463e-07,
      "loss": 0.0869,
      "mae_dtheta": 0.0212162546813488,
      "mae_dx": 0.016234751790761948,
      "mae_dy": 0.0034550921991467476,
      "pose_mae_dtheta": 0.15516135096549988,
      "pose_mae_dx": 0.1434526890516281,
      "pose_mae_dy": 0.054332032799720764,
      "pose_rmse_dtheta": 0.27834147214889526,
      "pose_rmse_dx": 0.27138206362724304,
      "pose_rmse_dy": 0.10036735236644745,
      "pose_rmse_mean": 0.21669696271419525,
      "rmse_dtheta": 0.035197969526052475,
      "rmse_dx": 0.028960373252630234,
      "rmse_dy": 0.005842072889208794,
      "rmse_mean": 0.0233334731310606,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 2461.0,
      "step": 10614,
      "turn_loss": 0.19260521233081818,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.4931704144211113,
      "grad_norm": 0.5850359797477722,
      "learning_rate": 3.320978675139919e-07,
      "loss": 0.1269,
      "mae_dtheta": 0.02884978987276554,
      "mae_dx": 0.00647289352491498,
      "mae_dy": 0.005248853471130133,
      "pose_mae_dtheta": 0.16617451608181,
      "pose_mae_dx": 0.06606541574001312,
      "pose_mae_dy": 0.059124406427145004,
      "pose_rmse_dtheta": 0.29694440960884094,
      "pose_rmse_dx": 0.14100854098796844,
      "pose_rmse_dy": 0.13170917332172394,
      "pose_rmse_mean": 0.1898873746395111,
      "rmse_dtheta": 0.044106099754571915,
      "rmse_dx": 0.015046726912260056,
      "rmse_dy": 0.010765395127236843,
      "rmse_mean": 0.023306075483560562,
      "rotation_flip": 0.016476552933454514,
      "sparse_tokens": 12592.0,
      "step": 10615,
      "turn_loss": 0.2781834006309509,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4932168741869541,
      "grad_norm": 0.48833829164505005,
      "learning_rate": 3.316241897753902e-07,
      "loss": 0.1061,
      "mae_dtheta": 0.0084916977211833,
      "mae_dx": 0.0014756742166355252,
      "mae_dy": 0.0023506933357566595,
      "pose_mae_dtheta": 0.0520893819630146,
      "pose_mae_dx": 0.01915869303047657,
      "pose_mae_dy": 0.02308577671647072,
      "pose_rmse_dtheta": 0.12200047075748444,
      "pose_rmse_dx": 0.045023638755083084,
      "pose_rmse_dy": 0.04947162792086601,
      "pose_rmse_mean": 0.07216525077819824,
      "rmse_dtheta": 0.017111172899603844,
      "rmse_dx": 0.0039218091405928135,
      "rmse_dy": 0.0054335505701601505,
      "rmse_mean": 0.008822177536785603,
      "rotation_flip": 0.0032271076925098896,
      "sparse_tokens": 32137.0,
      "step": 10616,
      "turn_loss": 0.07319629937410355,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.49326333395279687,
      "grad_norm": 0.8463027477264404,
      "learning_rate": 3.3115083849881545e-07,
      "loss": 0.155,
      "mae_dtheta": 0.013110850937664509,
      "mae_dx": 0.005084215197712183,
      "mae_dy": 0.004710154142230749,
      "pose_mae_dtheta": 0.10029976814985275,
      "pose_mae_dx": 0.04984316602349281,
      "pose_mae_dy": 0.050337646156549454,
      "pose_rmse_dtheta": 0.2775952219963074,
      "pose_rmse_dx": 0.19350393116474152,
      "pose_rmse_dy": 0.17681685090065002,
      "pose_rmse_mean": 0.21597199141979218,
      "rmse_dtheta": 0.030607685446739197,
      "rmse_dx": 0.01835540682077408,
      "rmse_dy": 0.015134722925722599,
      "rmse_mean": 0.02136593870818615,
      "rotation_flip": 0.007788162212818861,
      "sparse_tokens": 32105.0,
      "step": 10617,
      "turn_loss": 0.1696619689464569,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.49330979371863964,
      "grad_norm": 0.386957585811615,
      "learning_rate": 3.306778137173677e-07,
      "loss": 0.0603,
      "mae_dtheta": 0.008941899053752422,
      "mae_dx": 0.0014360533095896244,
      "mae_dy": 0.0012304640840739012,
      "pose_mae_dtheta": 0.061724137514829636,
      "pose_mae_dx": 0.015924574807286263,
      "pose_mae_dy": 0.01610889844596386,
      "pose_rmse_dtheta": 0.22485119104385376,
      "pose_rmse_dx": 0.059946924448013306,
      "pose_rmse_dy": 0.06511573493480682,
      "pose_rmse_mean": 0.1166379451751709,
      "rmse_dtheta": 0.02750081568956375,
      "rmse_dx": 0.005228724330663681,
      "rmse_dy": 0.0058778333477675915,
      "rmse_mean": 0.012869125232100487,
      "rotation_flip": 0.0017055144999176264,
      "sparse_tokens": 32121.0,
      "step": 10618,
      "turn_loss": 0.05822400003671646,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4933562534844824,
      "grad_norm": 0.561762809753418,
      "learning_rate": 3.302051154641267e-07,
      "loss": 0.119,
      "mae_dtheta": 0.010872053913772106,
      "mae_dx": 0.001096244785003364,
      "mae_dy": 0.002277423394843936,
      "pose_mae_dtheta": 0.07833483070135117,
      "pose_mae_dx": 0.017534831538796425,
      "pose_mae_dy": 0.026040665805339813,
      "pose_rmse_dtheta": 0.22095738351345062,
      "pose_rmse_dx": 0.049215056002140045,
      "pose_rmse_dy": 0.061949167400598526,
      "pose_rmse_mean": 0.11070720851421356,
      "rmse_dtheta": 0.023780403658747673,
      "rmse_dx": 0.0036139695439487696,
      "rmse_dy": 0.00578500097617507,
      "rmse_mean": 0.011059790849685669,
      "rotation_flip": 0.0022650056052953005,
      "sparse_tokens": 32057.0,
      "step": 10619,
      "turn_loss": 0.08159557729959488,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27816.0,
      "epoch": 0.4934027132503252,
      "grad_norm": 0.4674474000930786,
      "learning_rate": 3.297327437721493e-07,
      "loss": 0.0992,
      "mae_dtheta": 0.030240513384342194,
      "mae_dx": 0.012735877186059952,
      "mae_dy": 0.003728581592440605,
      "pose_mae_dtheta": 0.23439565300941467,
      "pose_mae_dx": 0.10481617599725723,
      "pose_mae_dy": 0.04622230678796768,
      "pose_rmse_dtheta": 0.45557618141174316,
      "pose_rmse_dx": 0.23408143222332,
      "pose_rmse_dy": 0.1126401424407959,
      "pose_rmse_mean": 0.2674326002597809,
      "rmse_dtheta": 0.05035890266299248,
      "rmse_dx": 0.024895470589399338,
      "rmse_dy": 0.00800298061221838,
      "rmse_mean": 0.027752451598644257,
      "rotation_flip": 0.011722272261977196,
      "sparse_tokens": 23197.0,
      "step": 10620,
      "turn_loss": 0.19807396829128265,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.493449173016168,
      "grad_norm": 0.37048467993736267,
      "learning_rate": 3.2926069867446673e-07,
      "loss": 0.0943,
      "mae_dtheta": 0.027376297861337662,
      "mae_dx": 0.008382228203117847,
      "mae_dy": 0.003143506357446313,
      "pose_mae_dtheta": 0.20891889929771423,
      "pose_mae_dx": 0.06843876838684082,
      "pose_mae_dy": 0.04489710554480553,
      "pose_rmse_dtheta": 0.3934025764465332,
      "pose_rmse_dx": 0.1672883927822113,
      "pose_rmse_dy": 0.1139945462346077,
      "pose_rmse_mean": 0.224895179271698,
      "rmse_dtheta": 0.045856229960918427,
      "rmse_dx": 0.020207827910780907,
      "rmse_dy": 0.007536462042480707,
      "rmse_mean": 0.024533508345484734,
      "rotation_flip": 0.013568521477282047,
      "sparse_tokens": 14819.0,
      "step": 10621,
      "turn_loss": 0.21224695444107056,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.49349563278201075,
      "grad_norm": 0.730745792388916,
      "learning_rate": 3.2878898020409113e-07,
      "loss": 0.1613,
      "mae_dtheta": 0.013798913918435574,
      "mae_dx": 0.0024761082604527473,
      "mae_dy": 0.00470637995749712,
      "pose_mae_dtheta": 0.0976765900850296,
      "pose_mae_dx": 0.03637316823005676,
      "pose_mae_dy": 0.03854551538825035,
      "pose_rmse_dtheta": 0.23233191668987274,
      "pose_rmse_dx": 0.10303081572055817,
      "pose_rmse_dy": 0.0784984827041626,
      "pose_rmse_mean": 0.1379537433385849,
      "rmse_dtheta": 0.027619877830147743,
      "rmse_dx": 0.006633726414293051,
      "rmse_dy": 0.009612755849957466,
      "rmse_mean": 0.014622120186686516,
      "rotation_flip": 0.004683840554207563,
      "sparse_tokens": 32073.0,
      "step": 10622,
      "turn_loss": 0.12829607725143433,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37964.0,
      "epoch": 0.4935420925478536,
      "grad_norm": 0.6146837472915649,
      "learning_rate": 3.2831758839400876e-07,
      "loss": 0.1313,
      "mae_dtheta": 0.028133561834692955,
      "mae_dx": 0.009613683447241783,
      "mae_dy": 0.0028284662403166294,
      "pose_mae_dtheta": 0.209975004196167,
      "pose_mae_dx": 0.07554783672094345,
      "pose_mae_dy": 0.030483728274703026,
      "pose_rmse_dtheta": 0.4157620370388031,
      "pose_rmse_dx": 0.1756480485200882,
      "pose_rmse_dy": 0.07977189123630524,
      "pose_rmse_mean": 0.22372733056545258,
      "rmse_dtheta": 0.04777129739522934,
      "rmse_dx": 0.020762501284480095,
      "rmse_dy": 0.005801934748888016,
      "rmse_mean": 0.02477858029305935,
      "rotation_flip": 0.008383233100175858,
      "sparse_tokens": 29864.0,
      "step": 10623,
      "turn_loss": 0.18363960087299347,
      "turns": 117.0,
      "turns_per_sample": 117.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.49358855231369636,
      "grad_norm": 0.4280717074871063,
      "learning_rate": 3.2784652327718544e-07,
      "loss": 0.118,
      "mae_dtheta": 0.03859643265604973,
      "mae_dx": 0.011385327205061913,
      "mae_dy": 0.007206174544990063,
      "pose_mae_dtheta": 0.31565117835998535,
      "pose_mae_dx": 0.08854296058416367,
      "pose_mae_dy": 0.07620014995336533,
      "pose_rmse_dtheta": 0.5751446485519409,
      "pose_rmse_dx": 0.18973414599895477,
      "pose_rmse_dy": 0.18820437788963318,
      "pose_rmse_mean": 0.31769439578056335,
      "rmse_dtheta": 0.058271374553442,
      "rmse_dx": 0.02414810098707676,
      "rmse_dy": 0.015604701824486256,
      "rmse_mean": 0.03267472982406616,
      "rotation_flip": 0.013501349836587906,
      "sparse_tokens": 17659.0,
      "step": 10624,
      "turn_loss": 0.3596458435058594,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.49363501207953914,
      "grad_norm": 0.5130351781845093,
      "learning_rate": 3.273757848865622e-07,
      "loss": 0.1008,
      "mae_dtheta": 0.008294293656945229,
      "mae_dx": 0.0010102714877575636,
      "mae_dy": 0.0005428503500297666,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5130351185798645,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.2295684814453,
      "model/head/act_norm_mean": 126.20828401199495,
      "model/head/act_norm_min": 85.86736297607422,
      "model/head/act_over_embed": 86.73151435361396,
      "model/head/grad_frac": 0.09584183990955353,
      "model/head/grad_norm": 0.04917022958397865,
      "model/head/grad_zero_frac": 0.00018147945229429752,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6926392834595959,
      "model/head/update_ratio": 0.0008370379218831658,
      "model/head/weight_delta": 9.97342300415039,
      "model/head/weight_delta_rel": 0.17496338486671448,
      "model/head/weight_norm": 58.743133544921875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229046702384949,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228357143156518,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42275261878967285,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905766615280429,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10007837414741516,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05134372040629387,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5547880901287554,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016578598879277706,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1544268131256104,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10306495428085327,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969879150390625,
      "model/modality_embedder/grad_frac": 0.10007837414741516,
      "model/modality_embedder/grad_norm": 0.05134372040629387,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5547880901287554,
      "model/modality_embedder/update_ratio": 0.0016578598879277706,
      "model/modality_embedder/weight_delta": 3.1544268131256104,
      "model/modality_embedder/weight_delta_rel": 0.10306495428085327,
      "model/modality_embedder/weight_norm": 30.969879150390625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.54914855957031,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.22167859147026,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.089812278747559,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.332573657133608,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.056084729731082916,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.028773436322808266,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010290960781276226,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7361860275268555,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09970826655626297,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.959911346435547,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.2721176147461,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.24597162097162,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.271177291870117,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.036477416589374,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0585624985396862,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030044618993997574,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010092755546793342,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4689323902130127,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12016653269529343,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76849937438965,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.16532135009766,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.101603835978835,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.216580390930176,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.31168524744484,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.061766285449266434,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03168827295303345,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.00103084952570498,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.758061170578003,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12618865072727203,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.739959716796875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.5710678100586,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.718812630270964,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.205659866333008,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.423046271429666,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06743171066045761,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.034594833850860596,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011549504706636071,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.229644298553467,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11037391424179077,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.953521728515625,
      "model/normalizer/grad_frac": 0.24340587854385376,
      "model/normalizer/grad_norm": 0.1248757615685463,
      "model/normalizer/grad_zero_frac": 0.0002280755143146962,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0015876315301284194,
      "model/normalizer/weight_delta": 6.793288707733154,
      "model/normalizer/weight_delta_rel": 0.08749362826347351,
      "model/normalizer/weight_norm": 78.65538024902344,
      "pose_mae_dtheta": 0.05991711840033531,
      "pose_mae_dx": 0.008373887278139591,
      "pose_mae_dy": 0.006410876289010048,
      "pose_rmse_dtheta": 0.2608751058578491,
      "pose_rmse_dx": 0.01859464682638645,
      "pose_rmse_dy": 0.015943994745612144,
      "pose_rmse_mean": 0.0984712541103363,
      "rmse_dtheta": 0.029407355934381485,
      "rmse_dx": 0.0027344473637640476,
      "rmse_dy": 0.0012963872868567705,
      "rmse_mean": 0.011146063916385174,
      "rotation_flip": 0.0020232675597071648,
      "sparse_tokens": 32185.0,
      "step": 10625,
      "turn_loss": 0.04110722616314888,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4936814718453819,
      "grad_norm": 0.30689865350723267,
      "learning_rate": 3.269053732550581e-07,
      "loss": 0.0655,
      "mae_dtheta": 0.0058748251758515835,
      "mae_dx": 0.0011960952542722225,
      "mae_dy": 0.0010715447133406997,
      "pose_mae_dtheta": 0.03786264359951019,
      "pose_mae_dx": 0.012250700034201145,
      "pose_mae_dy": 0.013695704750716686,
      "pose_rmse_dtheta": 0.09294483810663223,
      "pose_rmse_dx": 0.029457557946443558,
      "pose_rmse_dy": 0.033272720873355865,
      "pose_rmse_mean": 0.05189170688390732,
      "rmse_dtheta": 0.014695283956825733,
      "rmse_dx": 0.003842531703412533,
      "rmse_dy": 0.002509868470951915,
      "rmse_mean": 0.007015894632786512,
      "rotation_flip": 0.002610966097563505,
      "sparse_tokens": 32137.0,
      "step": 10626,
      "turn_loss": 0.046159543097019196,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.4937279316112247,
      "grad_norm": 0.6778809428215027,
      "learning_rate": 3.2643528841556973e-07,
      "loss": 0.1498,
      "mae_dtheta": 0.01958300918340683,
      "mae_dx": 0.0026747947558760643,
      "mae_dy": 0.003868606872856617,
      "pose_mae_dtheta": 0.15187294781208038,
      "pose_mae_dx": 0.029135163873434067,
      "pose_mae_dy": 0.0561738982796669,
      "pose_rmse_dtheta": 0.3106892704963684,
      "pose_rmse_dx": 0.0829925537109375,
      "pose_rmse_dy": 0.13460488617420197,
      "pose_rmse_mean": 0.17609557509422302,
      "rmse_dtheta": 0.03584704548120499,
      "rmse_dx": 0.009673849679529667,
      "rmse_dy": 0.007681653834879398,
      "rmse_mean": 0.017734182998538017,
      "rotation_flip": 0.007499999832361937,
      "sparse_tokens": 9152.0,
      "step": 10627,
      "turn_loss": 0.1716187596321106,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.49377439137706747,
      "grad_norm": 0.5672768354415894,
      "learning_rate": 3.2596553040097014e-07,
      "loss": 0.1219,
      "mae_dtheta": 0.03069092519581318,
      "mae_dx": 0.008764579892158508,
      "mae_dy": 0.003317122580483556,
      "pose_mae_dtheta": 0.23138757050037384,
      "pose_mae_dx": 0.05921230465173721,
      "pose_mae_dy": 0.043925512582063675,
      "pose_rmse_dtheta": 0.44122809171676636,
      "pose_rmse_dx": 0.14923861622810364,
      "pose_rmse_dy": 0.12466797232627869,
      "pose_rmse_mean": 0.23837825655937195,
      "rmse_dtheta": 0.05044983699917793,
      "rmse_dx": 0.020509924739599228,
      "rmse_dy": 0.00743114436045289,
      "rmse_mean": 0.026130301877856255,
      "rotation_flip": 0.008982036262750626,
      "sparse_tokens": 22480.0,
      "step": 10628,
      "turn_loss": 0.1995646208524704,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.49382085114291024,
      "grad_norm": 0.34252145886421204,
      "learning_rate": 3.2549609924410974e-07,
      "loss": 0.072,
      "mae_dtheta": 0.008559594862163067,
      "mae_dx": 0.0010253399377688766,
      "mae_dy": 0.0015646048123016953,
      "pose_mae_dtheta": 0.0516471303999424,
      "pose_mae_dx": 0.013646809384226799,
      "pose_mae_dy": 0.01963554322719574,
      "pose_rmse_dtheta": 0.15595906972885132,
      "pose_rmse_dx": 0.039080049842596054,
      "pose_rmse_dy": 0.04810401052236557,
      "pose_rmse_mean": 0.08104771375656128,
      "rmse_dtheta": 0.02243499644100666,
      "rmse_dx": 0.0034246251452714205,
      "rmse_dy": 0.0038358282763510942,
      "rmse_mean": 0.009898483753204346,
      "rotation_flip": 0.003633060958236456,
      "sparse_tokens": 32073.0,
      "step": 10629,
      "turn_loss": 0.05901913717389107,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24586.0,
      "epoch": 0.493867310908753,
      "grad_norm": 0.7149461507797241,
      "learning_rate": 3.250269949778156e-07,
      "loss": 0.1806,
      "mae_dtheta": 0.03865598514676094,
      "mae_dx": 0.013234060257673264,
      "mae_dy": 0.005579879507422447,
      "pose_mae_dtheta": 0.32032036781311035,
      "pose_mae_dx": 0.11592940986156464,
      "pose_mae_dy": 0.06144774705171585,
      "pose_rmse_dtheta": 0.5414445996284485,
      "pose_rmse_dx": 0.2504424750804901,
      "pose_rmse_dy": 0.14183445274829865,
      "pose_rmse_mean": 0.3112404942512512,
      "rmse_dtheta": 0.05725222826004028,
      "rmse_dx": 0.0256342776119709,
      "rmse_dy": 0.01208101399242878,
      "rmse_mean": 0.03165584057569504,
      "rotation_flip": 0.02022867277264595,
      "sparse_tokens": 19841.0,
      "step": 10630,
      "turn_loss": 0.2728642523288727,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4939137706745958,
      "grad_norm": 0.8378937840461731,
      "learning_rate": 3.245582176348927e-07,
      "loss": 0.1636,
      "mae_dtheta": 0.013046599924564362,
      "mae_dx": 0.003687631106004119,
      "mae_dy": 0.005055055022239685,
      "pose_mae_dtheta": 0.09584731608629227,
      "pose_mae_dx": 0.0401310995221138,
      "pose_mae_dy": 0.039725661277770996,
      "pose_rmse_dtheta": 0.21156366169452667,
      "pose_rmse_dx": 0.1024441048502922,
      "pose_rmse_dy": 0.09125903248786926,
      "pose_rmse_mean": 0.1350889354944229,
      "rmse_dtheta": 0.024967223405838013,
      "rmse_dx": 0.00883160624653101,
      "rmse_dy": 0.009767825715243816,
      "rmse_mean": 0.014522219076752663,
      "rotation_flip": 0.005679919850081205,
      "sparse_tokens": 32121.0,
      "step": 10631,
      "turn_loss": 0.12712664902210236,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.4939602304404386,
      "grad_norm": 0.765154242515564,
      "learning_rate": 3.2408976724812415e-07,
      "loss": 0.0946,
      "mae_dtheta": 0.048492681235075,
      "mae_dx": 0.019571557641029358,
      "mae_dy": 0.01921987161040306,
      "pose_mae_dtheta": 0.38610491156578064,
      "pose_mae_dx": 0.17147886753082275,
      "pose_mae_dy": 0.19872651994228363,
      "pose_rmse_dtheta": 0.5556392073631287,
      "pose_rmse_dx": 0.2648310363292694,
      "pose_rmse_dy": 0.3541117012500763,
      "pose_rmse_mean": 0.39152729511260986,
      "rmse_dtheta": 0.06670928746461868,
      "rmse_dx": 0.03129582479596138,
      "rmse_dy": 0.029276929795742035,
      "rmse_mean": 0.04242735356092453,
      "rotation_flip": 0.009925558231770992,
      "sparse_tokens": 6975.0,
      "step": 10632,
      "turn_loss": 0.6369061470031738,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.49400669020628135,
      "grad_norm": 0.5150597095489502,
      "learning_rate": 3.2362164385026704e-07,
      "loss": 0.1557,
      "mae_dtheta": 0.03464719280600548,
      "mae_dx": 0.008166440762579441,
      "mae_dy": 0.0058999452739953995,
      "pose_mae_dtheta": 0.26187118887901306,
      "pose_mae_dx": 0.06826145201921463,
      "pose_mae_dy": 0.07064703106880188,
      "pose_rmse_dtheta": 0.5277979969978333,
      "pose_rmse_dx": 0.14413347840309143,
      "pose_rmse_dy": 0.13770264387130737,
      "pose_rmse_mean": 0.2698780596256256,
      "rmse_dtheta": 0.054941993206739426,
      "rmse_dx": 0.01765473745763302,
      "rmse_dy": 0.010857709683477879,
      "rmse_mean": 0.027818147093057632,
      "rotation_flip": 0.01701570674777031,
      "sparse_tokens": 12918.0,
      "step": 10633,
      "turn_loss": 0.22698935866355896,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.49405314997212413,
      "grad_norm": 0.6711332201957703,
      "learning_rate": 3.231538474740592e-07,
      "loss": 0.1374,
      "mae_dtheta": 0.00882325042039156,
      "mae_dx": 0.0014612394152209163,
      "mae_dy": 0.000893071002792567,
      "pose_mae_dtheta": 0.06568881869316101,
      "pose_mae_dx": 0.012542679905891418,
      "pose_mae_dy": 0.012064643204212189,
      "pose_rmse_dtheta": 0.24729853868484497,
      "pose_rmse_dx": 0.03796853870153427,
      "pose_rmse_dy": 0.0443640872836113,
      "pose_rmse_mean": 0.10987706482410431,
      "rmse_dtheta": 0.02677355334162712,
      "rmse_dx": 0.004772392101585865,
      "rmse_dy": 0.002680158009752631,
      "rmse_mean": 0.011408700607717037,
      "rotation_flip": 0.0026343518402427435,
      "sparse_tokens": 32153.0,
      "step": 10634,
      "turn_loss": 0.06433426588773727,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4940996097379669,
      "grad_norm": 0.3994523882865906,
      "learning_rate": 3.226863781522127e-07,
      "loss": 0.0718,
      "mae_dtheta": 0.007003760430961847,
      "mae_dx": 0.0018274023896083236,
      "mae_dy": 0.003157322993502021,
      "pose_mae_dtheta": 0.048126962035894394,
      "pose_mae_dx": 0.02596757933497429,
      "pose_mae_dy": 0.025665882974863052,
      "pose_rmse_dtheta": 0.10555964708328247,
      "pose_rmse_dx": 0.07300077378749847,
      "pose_rmse_dy": 0.06083524227142334,
      "pose_rmse_mean": 0.07979855686426163,
      "rmse_dtheta": 0.014831341803073883,
      "rmse_dx": 0.004764302168041468,
      "rmse_dy": 0.006918095517903566,
      "rmse_mean": 0.008837913163006306,
      "rotation_flip": 0.003822630038484931,
      "sparse_tokens": 32057.0,
      "step": 10635,
      "turn_loss": 0.0689472183585167,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19742.0,
      "epoch": 0.4941460695038097,
      "grad_norm": 1.0123541355133057,
      "learning_rate": 3.222192359174181e-07,
      "loss": 0.2591,
      "mae_dtheta": 0.02838847041130066,
      "mae_dx": 0.012221721932291985,
      "mae_dy": 0.006619694177061319,
      "pose_mae_dtheta": 0.22156620025634766,
      "pose_mae_dx": 0.09287886321544647,
      "pose_mae_dy": 0.08200409263372421,
      "pose_rmse_dtheta": 0.36210718750953674,
      "pose_rmse_dx": 0.2092352956533432,
      "pose_rmse_dy": 0.1795872151851654,
      "pose_rmse_mean": 0.25030991435050964,
      "rmse_dtheta": 0.042980171740055084,
      "rmse_dx": 0.02530685067176819,
      "rmse_dy": 0.011825883761048317,
      "rmse_mean": 0.026704302057623863,
      "rotation_flip": 0.009990010410547256,
      "sparse_tokens": 15095.0,
      "step": 10636,
      "turn_loss": 0.29797038435935974,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.49419252926965246,
      "grad_norm": 0.4109337329864502,
      "learning_rate": 3.2175242080234314e-07,
      "loss": 0.0639,
      "mae_dtheta": 0.010374610312283039,
      "mae_dx": 0.001835011295042932,
      "mae_dy": 0.00238195457495749,
      "pose_mae_dtheta": 0.0641375184059143,
      "pose_mae_dx": 0.0198484119027853,
      "pose_mae_dy": 0.026540333405137062,
      "pose_rmse_dtheta": 0.17981991171836853,
      "pose_rmse_dx": 0.047031037509441376,
      "pose_rmse_dy": 0.06376831233501434,
      "pose_rmse_mean": 0.09687308967113495,
      "rmse_dtheta": 0.022917330265045166,
      "rmse_dx": 0.005562278442084789,
      "rmse_dy": 0.0052667115814983845,
      "rmse_mean": 0.011248773895204067,
      "rotation_flip": 0.006531454157084227,
      "sparse_tokens": 32137.0,
      "step": 10637,
      "turn_loss": 0.0979250818490982,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33413.0,
      "epoch": 0.49423898903549524,
      "grad_norm": 0.5598815679550171,
      "learning_rate": 3.2128593283963173e-07,
      "loss": 0.1485,
      "mae_dtheta": 0.0238119475543499,
      "mae_dx": 0.007452336139976978,
      "mae_dy": 0.0033138946164399385,
      "pose_mae_dtheta": 0.17644605040550232,
      "pose_mae_dx": 0.06380924582481384,
      "pose_mae_dy": 0.046636998653411865,
      "pose_rmse_dtheta": 0.36308565735816956,
      "pose_rmse_dx": 0.17938005924224854,
      "pose_rmse_dy": 0.1076061800122261,
      "pose_rmse_mean": 0.21669062972068787,
      "rmse_dtheta": 0.041946154087781906,
      "rmse_dx": 0.019406285136938095,
      "rmse_dy": 0.006510837469249964,
      "rmse_mean": 0.022621093317866325,
      "rotation_flip": 0.01410658285021782,
      "sparse_tokens": 27493.0,
      "step": 10638,
      "turn_loss": 0.1761367917060852,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.49428544880133807,
      "grad_norm": 0.4593176245689392,
      "learning_rate": 3.2081977206190715e-07,
      "loss": 0.1223,
      "mae_dtheta": 0.007107132580131292,
      "mae_dx": 0.0011752512073144317,
      "mae_dy": 0.0011696669971570373,
      "pose_mae_dtheta": 0.045878902077674866,
      "pose_mae_dx": 0.012829755432903767,
      "pose_mae_dy": 0.01626889407634735,
      "pose_rmse_dtheta": 0.1409374475479126,
      "pose_rmse_dx": 0.04113943129777908,
      "pose_rmse_dy": 0.04647020623087883,
      "pose_rmse_mean": 0.07618236541748047,
      "rmse_dtheta": 0.019097361713647842,
      "rmse_dx": 0.004652904346585274,
      "rmse_dy": 0.0031346692703664303,
      "rmse_mean": 0.008961645886301994,
      "rotation_flip": 0.004107980988919735,
      "sparse_tokens": 32041.0,
      "step": 10639,
      "turn_loss": 0.06114271283149719,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.49433190856718084,
      "grad_norm": 0.427777498960495,
      "learning_rate": 3.203539385017668e-07,
      "loss": 0.1153,
      "mae_dtheta": 0.03146832063794136,
      "mae_dx": 0.007829035632312298,
      "mae_dy": 0.005244026891887188,
      "pose_mae_dtheta": 0.22507435083389282,
      "pose_mae_dx": 0.05544918030500412,
      "pose_mae_dy": 0.0696776881814003,
      "pose_rmse_dtheta": 0.37370410561561584,
      "pose_rmse_dx": 0.15964792668819427,
      "pose_rmse_dy": 0.13833598792552948,
      "pose_rmse_mean": 0.22389601171016693,
      "rmse_dtheta": 0.04475425183773041,
      "rmse_dx": 0.020157020539045334,
      "rmse_dy": 0.008074544370174408,
      "rmse_mean": 0.024328608065843582,
      "rotation_flip": 0.009345794096589088,
      "sparse_tokens": 10352.0,
      "step": 10640,
      "turn_loss": 0.23371072113513947,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.4943783683330236,
      "grad_norm": 1.1099646091461182,
      "learning_rate": 3.1988843219178776e-07,
      "loss": 0.2586,
      "mae_dtheta": 0.03192745894193649,
      "mae_dx": 0.0151435025036335,
      "mae_dy": 0.0058364905416965485,
      "pose_mae_dtheta": 0.19771088659763336,
      "pose_mae_dx": 0.11816897988319397,
      "pose_mae_dy": 0.07758183032274246,
      "pose_rmse_dtheta": 0.3318485915660858,
      "pose_rmse_dx": 0.25544244050979614,
      "pose_rmse_dy": 0.16945594549179077,
      "pose_rmse_mean": 0.25224900245666504,
      "rmse_dtheta": 0.047936905175447464,
      "rmse_dx": 0.029513034969568253,
      "rmse_dy": 0.009831452742218971,
      "rmse_mean": 0.029093798249959946,
      "rotation_flip": 0.010273972526192665,
      "sparse_tokens": 5188.0,
      "step": 10641,
      "turn_loss": 0.26515933871269226,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4944248280988664,
      "grad_norm": 0.37301579117774963,
      "learning_rate": 3.1942325316452194e-07,
      "loss": 0.1175,
      "mae_dtheta": 0.008692474104464054,
      "mae_dx": 0.0012050617951899767,
      "mae_dy": 0.0020299453753978014,
      "pose_mae_dtheta": 0.051583752036094666,
      "pose_mae_dx": 0.017807211726903915,
      "pose_mae_dy": 0.022524721920490265,
      "pose_rmse_dtheta": 0.13434116542339325,
      "pose_rmse_dx": 0.04260633513331413,
      "pose_rmse_dy": 0.05563843622803688,
      "pose_rmse_mean": 0.07752864807844162,
      "rmse_dtheta": 0.020176945254206657,
      "rmse_dx": 0.0030918458942323923,
      "rmse_dy": 0.004887872375547886,
      "rmse_mean": 0.009385555051267147,
      "rotation_flip": 0.002568807452917099,
      "sparse_tokens": 32137.0,
      "step": 10642,
      "turn_loss": 0.07336685061454773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4944712878647092,
      "grad_norm": 0.3296109139919281,
      "learning_rate": 3.189584014525016e-07,
      "loss": 0.0903,
      "mae_dtheta": 0.004545743577182293,
      "mae_dx": 0.0011127822799608111,
      "mae_dy": 0.000645841530058533,
      "pose_mae_dtheta": 0.033947695046663284,
      "pose_mae_dx": 0.011632285080850124,
      "pose_mae_dy": 0.010045460425317287,
      "pose_rmse_dtheta": 0.15074244141578674,
      "pose_rmse_dx": 0.029474997892975807,
      "pose_rmse_dy": 0.030598657205700874,
      "pose_rmse_mean": 0.0702720358967781,
      "rmse_dtheta": 0.0169124323874712,
      "rmse_dx": 0.0033612416591495275,
      "rmse_dy": 0.0016284268349409103,
      "rmse_mean": 0.007300700526684523,
      "rotation_flip": 0.002739726100116968,
      "sparse_tokens": 32121.0,
      "step": 10643,
      "turn_loss": 0.043982625007629395,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.49451774763055195,
      "grad_norm": 0.5003076791763306,
      "learning_rate": 3.184938770882312e-07,
      "loss": 0.0707,
      "mae_dtheta": 0.004802992567420006,
      "mae_dx": 0.001490413909777999,
      "mae_dy": 0.0009671277948655188,
      "pose_mae_dtheta": 0.03267746418714523,
      "pose_mae_dx": 0.013109734281897545,
      "pose_mae_dy": 0.011532692238688469,
      "pose_rmse_dtheta": 0.11279983073472977,
      "pose_rmse_dx": 0.04795737564563751,
      "pose_rmse_dy": 0.035839419811964035,
      "pose_rmse_mean": 0.06553221493959427,
      "rmse_dtheta": 0.017101652920246124,
      "rmse_dx": 0.006315948907285929,
      "rmse_dy": 0.002946926513686776,
      "rmse_mean": 0.008788175880908966,
      "rotation_flip": 0.004494382068514824,
      "sparse_tokens": 32073.0,
      "step": 10644,
      "turn_loss": 0.03529796004295349,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.49456420739639473,
      "grad_norm": 0.7083141803741455,
      "learning_rate": 3.180296801041971e-07,
      "loss": 0.1787,
      "mae_dtheta": 0.0077026281505823135,
      "mae_dx": 0.0012838015099987388,
      "mae_dy": 0.001757267047651112,
      "pose_mae_dtheta": 0.05016547068953514,
      "pose_mae_dx": 0.01711280643939972,
      "pose_mae_dy": 0.02240997552871704,
      "pose_rmse_dtheta": 0.11504288762807846,
      "pose_rmse_dx": 0.051786500960588455,
      "pose_rmse_dy": 0.061403658241033554,
      "pose_rmse_mean": 0.07607768476009369,
      "rmse_dtheta": 0.016678860411047935,
      "rmse_dx": 0.003790162270888686,
      "rmse_dy": 0.004141916520893574,
      "rmse_mean": 0.00820364709943533,
      "rotation_flip": 0.002990175038576126,
      "sparse_tokens": 32089.0,
      "step": 10645,
      "turn_loss": 0.06615875661373138,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.4946106671622375,
      "grad_norm": 0.3809858560562134,
      "learning_rate": 3.1756581053286107e-07,
      "loss": 0.0836,
      "mae_dtheta": 0.007637152448296547,
      "mae_dx": 0.0015052403323352337,
      "mae_dy": 0.0017579977866262197,
      "pose_mae_dtheta": 0.05013743415474892,
      "pose_mae_dx": 0.01585991121828556,
      "pose_mae_dy": 0.014941859059035778,
      "pose_rmse_dtheta": 0.1428690254688263,
      "pose_rmse_dx": 0.04063596576452255,
      "pose_rmse_dy": 0.034547533839941025,
      "pose_rmse_mean": 0.07268418371677399,
      "rmse_dtheta": 0.019741808995604515,
      "rmse_dx": 0.003979336936026812,
      "rmse_dy": 0.0040064905770123005,
      "rmse_mean": 0.009242545813322067,
      "rotation_flip": 0.0026569245383143425,
      "sparse_tokens": 32217.0,
      "step": 10646,
      "turn_loss": 0.06077651306986809,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.4946571269280803,
      "grad_norm": 0.9701752066612244,
      "learning_rate": 3.171022684066599e-07,
      "loss": 0.2983,
      "mae_dtheta": 0.029454028233885765,
      "mae_dx": 0.010973812080919743,
      "mae_dy": 0.007508186623454094,
      "pose_mae_dtheta": 0.2245846539735794,
      "pose_mae_dx": 0.0991499200463295,
      "pose_mae_dy": 0.1132306307554245,
      "pose_rmse_dtheta": 0.36646324396133423,
      "pose_rmse_dx": 0.20842155814170837,
      "pose_rmse_dy": 0.1992194503545761,
      "pose_rmse_mean": 0.25803476572036743,
      "rmse_dtheta": 0.04164545238018036,
      "rmse_dx": 0.02351432666182518,
      "rmse_dy": 0.01173519529402256,
      "rmse_mean": 0.025631658732891083,
      "rotation_flip": 0.016091953963041306,
      "sparse_tokens": 8417.0,
      "step": 10647,
      "turn_loss": 0.2549154460430145,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.49470358669392306,
      "grad_norm": 0.5188568234443665,
      "learning_rate": 3.166390537580122e-07,
      "loss": 0.111,
      "mae_dtheta": 0.006153079215437174,
      "mae_dx": 0.0012865301687270403,
      "mae_dy": 0.0017368459375575185,
      "pose_mae_dtheta": 0.039421238005161285,
      "pose_mae_dx": 0.018432894721627235,
      "pose_mae_dy": 0.019904932007193565,
      "pose_rmse_dtheta": 0.09771755337715149,
      "pose_rmse_dx": 0.053164009004831314,
      "pose_rmse_dy": 0.046890076249837875,
      "pose_rmse_mean": 0.06592388451099396,
      "rmse_dtheta": 0.014915320090949535,
      "rmse_dx": 0.003813836257904768,
      "rmse_dy": 0.004156912211328745,
      "rmse_mean": 0.007628689520061016,
      "rotation_flip": 0.003636363660916686,
      "sparse_tokens": 32105.0,
      "step": 10648,
      "turn_loss": 0.05943701043725014,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.49475004645976584,
      "grad_norm": 0.44345468282699585,
      "learning_rate": 3.161761666193086e-07,
      "loss": 0.1101,
      "mae_dtheta": 0.034692324697971344,
      "mae_dx": 0.013640058226883411,
      "mae_dy": 0.007558145094662905,
      "pose_mae_dtheta": 0.27367857098579407,
      "pose_mae_dx": 0.09860587120056152,
      "pose_mae_dy": 0.10870043188333511,
      "pose_rmse_dtheta": 0.40288636088371277,
      "pose_rmse_dx": 0.20119455456733704,
      "pose_rmse_dy": 0.20987845957279205,
      "pose_rmse_mean": 0.27131980657577515,
      "rmse_dtheta": 0.04697438329458237,
      "rmse_dx": 0.02595820464193821,
      "rmse_dy": 0.01350010372698307,
      "rmse_mean": 0.02881089597940445,
      "rotation_flip": 0.0,
      "sparse_tokens": 3497.0,
      "step": 10649,
      "turn_loss": 0.3672112226486206,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4947965062256086,
      "grad_norm": 0.3535856306552887,
      "learning_rate": 3.157136070229189e-07,
      "loss": 0.0871,
      "mae_dtheta": 0.008962726220488548,
      "mae_dx": 0.0014313844731077552,
      "mae_dy": 0.002570640528574586,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3535856306552887,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.87408447265625,
      "model/head/act_norm_mean": 104.01736111111111,
      "model/head/act_norm_min": 60.79888916015625,
      "model/head/act_over_embed": 71.48170438143316,
      "model/head/grad_frac": 0.11375688016414642,
      "model/head/grad_norm": 0.04022279754281044,
      "model/head/grad_zero_frac": 0.00020495755597949028,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7092211174242424,
      "model/head/update_ratio": 0.0006847219192422926,
      "model/head/weight_delta": 9.974015235900879,
      "model/head/weight_delta_rel": 0.1749737709760666,
      "model/head/weight_norm": 58.74325942993164,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42289257049560547,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228332657619839,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42277219891548157,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905749788590386,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10381075739860535,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03670599311590195,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5366940045248869,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011852169409394264,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1541616916656494,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10305629670619965,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969852447509766,
      "model/modality_embedder/grad_frac": 0.10381075739860535,
      "model/modality_embedder/grad_norm": 0.03670599311590195,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5366940045248869,
      "model/modality_embedder/update_ratio": 0.0011852169409394264,
      "model/modality_embedder/weight_delta": 3.1541616916656494,
      "model/modality_embedder/weight_delta_rel": 0.10305629670619965,
      "model/modality_embedder/weight_norm": 30.969852447509766,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.90833282470703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.058960137085137,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.019082069396973,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.846333287590976,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07059766352176666,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.024962319061160088,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008927868911996484,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.736562728881836,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0997219979763031,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.959997177124023,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 94.69949340820312,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.026214526214527,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.305023193359375,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.511039559378958,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0739021971821785,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.026130754500627518,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008777957409620285,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4693667888641357,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12018157541751862,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.768604278564453,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 96.16105651855469,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.87789351851852,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.152528762817383,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.783530698582116,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07271679490804672,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02571161277592182,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000322788895573467,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008364195236936212,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.758511781692505,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12620379030704498,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.74009132385254,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.79598236083984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.599527016193683,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.232141494750977,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.96665335637124,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0765230730175972,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.027057459577918053,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009033087990246713,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.230182409286499,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11039230227470398,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.953720092773438,
      "model/normalizer/grad_frac": 0.3082442879676819,
      "model/normalizer/grad_norm": 0.10899075120687485,
      "model/normalizer/grad_zero_frac": 0.00027770851738750935,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0013856719015166163,
      "model/normalizer/weight_delta": 6.7941975593566895,
      "model/normalizer/weight_delta_rel": 0.08750533312559128,
      "model/normalizer/weight_norm": 78.65552520751953,
      "pose_mae_dtheta": 0.055080294609069824,
      "pose_mae_dx": 0.024156097322702408,
      "pose_mae_dy": 0.026372870430350304,
      "pose_rmse_dtheta": 0.11816704273223877,
      "pose_rmse_dx": 0.06960518658161163,
      "pose_rmse_dy": 0.060155533254146576,
      "pose_rmse_mean": 0.0826425850391388,
      "rmse_dtheta": 0.01833205670118332,
      "rmse_dx": 0.004147226456552744,
      "rmse_dy": 0.005913724657148123,
      "rmse_mean": 0.009464336559176445,
      "rotation_flip": 0.0039047247264534235,
      "sparse_tokens": 32089.0,
      "step": 10650,
      "turn_loss": 0.0689028948545456,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.4948429659914514,
      "grad_norm": 0.6882765293121338,
      "learning_rate": 3.1525137500119207e-07,
      "loss": 0.2146,
      "mae_dtheta": 0.024399250745773315,
      "mae_dx": 0.007688754703849554,
      "mae_dy": 0.003962826449424028,
      "pose_mae_dtheta": 0.17541839182376862,
      "pose_mae_dx": 0.0581040158867836,
      "pose_mae_dy": 0.04852874204516411,
      "pose_rmse_dtheta": 0.38210558891296387,
      "pose_rmse_dx": 0.1544000506401062,
      "pose_rmse_dy": 0.12139032781124115,
      "pose_rmse_mean": 0.21929866075515747,
      "rmse_dtheta": 0.044251035898923874,
      "rmse_dx": 0.019138947129249573,
      "rmse_dy": 0.010072764940559864,
      "rmse_mean": 0.024487584829330444,
      "rotation_flip": 0.012422360479831696,
      "sparse_tokens": 13566.0,
      "step": 10651,
      "turn_loss": 0.18148167431354523,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.49488942575729417,
      "grad_norm": 0.3393070101737976,
      "learning_rate": 3.1478947058645015e-07,
      "loss": 0.084,
      "mae_dtheta": 0.03979772329330444,
      "mae_dx": 0.00916261039674282,
      "mae_dy": 0.0045580011792480946,
      "pose_mae_dtheta": 0.31503745913505554,
      "pose_mae_dx": 0.0691058337688446,
      "pose_mae_dy": 0.06018811836838722,
      "pose_rmse_dtheta": 0.5327864289283752,
      "pose_rmse_dx": 0.16824977099895477,
      "pose_rmse_dy": 0.13997137546539307,
      "pose_rmse_mean": 0.2803358733654022,
      "rmse_dtheta": 0.05994752421975136,
      "rmse_dx": 0.020811554044485092,
      "rmse_dy": 0.010490071959793568,
      "rmse_mean": 0.03041638433933258,
      "rotation_flip": 0.004310344811528921,
      "sparse_tokens": 7620.0,
      "step": 10652,
      "turn_loss": 0.25904381275177,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.49493588552313694,
      "grad_norm": 0.5734049081802368,
      "learning_rate": 3.143278938109956e-07,
      "loss": 0.1128,
      "mae_dtheta": 0.011696083471179008,
      "mae_dx": 0.002248126547783613,
      "mae_dy": 0.0035470102448016405,
      "pose_mae_dtheta": 0.07405319809913635,
      "pose_mae_dx": 0.02584521844983101,
      "pose_mae_dy": 0.0338144525885582,
      "pose_rmse_dtheta": 0.17043918371200562,
      "pose_rmse_dx": 0.06821344047784805,
      "pose_rmse_dy": 0.08002471178770065,
      "pose_rmse_mean": 0.10622578114271164,
      "rmse_dtheta": 0.02393973059952259,
      "rmse_dx": 0.006769618485122919,
      "rmse_dy": 0.008342216722667217,
      "rmse_mean": 0.013017188757658005,
      "rotation_flip": 0.007125044707208872,
      "sparse_tokens": 32073.0,
      "step": 10653,
      "turn_loss": 0.12189280986785889,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4949823452889797,
      "grad_norm": 0.32235658168792725,
      "learning_rate": 3.138666447071059e-07,
      "loss": 0.0712,
      "mae_dtheta": 0.0104141253978014,
      "mae_dx": 0.0021826177835464478,
      "mae_dy": 0.003159966552630067,
      "pose_mae_dtheta": 0.06757587194442749,
      "pose_mae_dx": 0.02892163023352623,
      "pose_mae_dy": 0.03040187805891037,
      "pose_rmse_dtheta": 0.15146227180957794,
      "pose_rmse_dx": 0.07479091733694077,
      "pose_rmse_dy": 0.07268256694078445,
      "pose_rmse_mean": 0.09964524954557419,
      "rmse_dtheta": 0.021845124661922455,
      "rmse_dx": 0.005796880926936865,
      "rmse_dy": 0.006939179264008999,
      "rmse_mean": 0.011527061462402344,
      "rotation_flip": 0.01020007859915495,
      "sparse_tokens": 32105.0,
      "step": 10654,
      "turn_loss": 0.09496662765741348,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4950288050548225,
      "grad_norm": 0.5012991428375244,
      "learning_rate": 3.134057233070376e-07,
      "loss": 0.1079,
      "mae_dtheta": 0.008679032325744629,
      "mae_dx": 0.0018312841420993209,
      "mae_dy": 0.0017103244317695498,
      "pose_mae_dtheta": 0.06488139927387238,
      "pose_mae_dx": 0.018813326954841614,
      "pose_mae_dy": 0.018577447161078453,
      "pose_rmse_dtheta": 0.21577982604503632,
      "pose_rmse_dx": 0.06280333548784256,
      "pose_rmse_dy": 0.07031233608722687,
      "pose_rmse_mean": 0.11629849672317505,
      "rmse_dtheta": 0.024372979998588562,
      "rmse_dx": 0.006570290774106979,
      "rmse_dy": 0.005534444469958544,
      "rmse_mean": 0.012159238569438457,
      "rotation_flip": 0.003392130369320512,
      "sparse_tokens": 32073.0,
      "step": 10655,
      "turn_loss": 0.0591001994907856,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.49507526482066533,
      "grad_norm": 0.3591988980770111,
      "learning_rate": 3.129451296430219e-07,
      "loss": 0.0942,
      "mae_dtheta": 0.012198584154248238,
      "mae_dx": 0.0024491578806191683,
      "mae_dy": 0.0033887261524796486,
      "pose_mae_dtheta": 0.0836699828505516,
      "pose_mae_dx": 0.030845897272229195,
      "pose_mae_dy": 0.03280052915215492,
      "pose_rmse_dtheta": 0.23603779077529907,
      "pose_rmse_dx": 0.09018893539905548,
      "pose_rmse_dy": 0.09878471493721008,
      "pose_rmse_mean": 0.14167048037052155,
      "rmse_dtheta": 0.02829749695956707,
      "rmse_dx": 0.006659625563770533,
      "rmse_dy": 0.007745486684143543,
      "rmse_mean": 0.014234202913939953,
      "rotation_flip": 0.0049019609577953815,
      "sparse_tokens": 32137.0,
      "step": 10656,
      "turn_loss": 0.1255626529455185,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4951217245865081,
      "grad_norm": 0.426449179649353,
      "learning_rate": 3.1248486374726884e-07,
      "loss": 0.0956,
      "mae_dtheta": 0.007936648093163967,
      "mae_dx": 0.0017305408837273717,
      "mae_dy": 0.0017807547701522708,
      "pose_mae_dtheta": 0.047589320689439774,
      "pose_mae_dx": 0.019212916493415833,
      "pose_mae_dy": 0.020674102008342743,
      "pose_rmse_dtheta": 0.10499977320432663,
      "pose_rmse_dx": 0.05015621706843376,
      "pose_rmse_dy": 0.04433252662420273,
      "pose_rmse_mean": 0.06649617850780487,
      "rmse_dtheta": 0.017544619739055634,
      "rmse_dx": 0.005754721816629171,
      "rmse_dy": 0.004736849572509527,
      "rmse_mean": 0.009345397353172302,
      "rotation_flip": 0.006791849620640278,
      "sparse_tokens": 32089.0,
      "step": 10657,
      "turn_loss": 0.07271770387887955,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4951681843523509,
      "grad_norm": 0.45035433769226074,
      "learning_rate": 3.1202492565196643e-07,
      "loss": 0.1093,
      "mae_dtheta": 0.00709735369309783,
      "mae_dx": 0.0018042162992060184,
      "mae_dy": 0.0020885556004941463,
      "pose_mae_dtheta": 0.04708026722073555,
      "pose_mae_dx": 0.019897790625691414,
      "pose_mae_dy": 0.022855384275317192,
      "pose_rmse_dtheta": 0.10090488195419312,
      "pose_rmse_dx": 0.06949129700660706,
      "pose_rmse_dy": 0.05938200280070305,
      "pose_rmse_mean": 0.07659272849559784,
      "rmse_dtheta": 0.015452401712536812,
      "rmse_dx": 0.007589371409267187,
      "rmse_dy": 0.0061821904964745045,
      "rmse_mean": 0.009741321206092834,
      "rotation_flip": 0.00967032928019762,
      "sparse_tokens": 32089.0,
      "step": 10658,
      "turn_loss": 0.06731808930635452,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8760.0,
      "epoch": 0.49521464411819366,
      "grad_norm": 0.5936264991760254,
      "learning_rate": 3.1156531538927615e-07,
      "loss": 0.1899,
      "mae_dtheta": 0.030159208923578262,
      "mae_dx": 0.007973482832312584,
      "mae_dy": 0.003777615260332823,
      "pose_mae_dtheta": 0.23106403648853302,
      "pose_mae_dx": 0.051077213138341904,
      "pose_mae_dy": 0.047064874321222305,
      "pose_rmse_dtheta": 0.4299015700817108,
      "pose_rmse_dx": 0.14445385336875916,
      "pose_rmse_dy": 0.12697893381118774,
      "pose_rmse_mean": 0.23377811908721924,
      "rmse_dtheta": 0.04842832311987877,
      "rmse_dx": 0.020137036219239235,
      "rmse_dy": 0.007808788679540157,
      "rmse_mean": 0.02545805089175701,
      "rotation_flip": 0.018648019060492516,
      "sparse_tokens": 7541.0,
      "step": 10659,
      "turn_loss": 0.22799399495124817,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.49526110388403644,
      "grad_norm": 0.5416564345359802,
      "learning_rate": 3.1110603299134014e-07,
      "loss": 0.1352,
      "mae_dtheta": 0.03752076253294945,
      "mae_dx": 0.013760567642748356,
      "mae_dy": 0.00497856130823493,
      "pose_mae_dtheta": 0.2933999001979828,
      "pose_mae_dx": 0.10280892997980118,
      "pose_mae_dy": 0.048794303089380264,
      "pose_rmse_dtheta": 0.5312093496322632,
      "pose_rmse_dx": 0.22790247201919556,
      "pose_rmse_dy": 0.11095300316810608,
      "pose_rmse_mean": 0.2900216281414032,
      "rmse_dtheta": 0.05715813487768173,
      "rmse_dx": 0.026228981092572212,
      "rmse_dy": 0.010839191265404224,
      "rmse_mean": 0.03140877187252045,
      "rotation_flip": 0.013253011740744114,
      "sparse_tokens": 26916.0,
      "step": 10660,
      "turn_loss": 0.3104974329471588,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4953075636498792,
      "grad_norm": 0.4074512720108032,
      "learning_rate": 3.106470784902754e-07,
      "loss": 0.0835,
      "mae_dtheta": 0.009351986460387707,
      "mae_dx": 0.0013797617284581065,
      "mae_dy": 0.0027324564289301634,
      "pose_mae_dtheta": 0.0621078796684742,
      "pose_mae_dx": 0.020286183804273605,
      "pose_mae_dy": 0.029178394004702568,
      "pose_rmse_dtheta": 0.13423186540603638,
      "pose_rmse_dx": 0.05434178560972214,
      "pose_rmse_dy": 0.06175696849822998,
      "pose_rmse_mean": 0.0834435448050499,
      "rmse_dtheta": 0.019713789224624634,
      "rmse_dx": 0.0041679926216602325,
      "rmse_dy": 0.005856832955032587,
      "rmse_mean": 0.00991287175565958,
      "rotation_flip": 0.004492699168622494,
      "sparse_tokens": 32057.0,
      "step": 10661,
      "turn_loss": 0.06773889064788818,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36014.0,
      "epoch": 0.495354023415722,
      "grad_norm": 0.32361504435539246,
      "learning_rate": 3.1018845191817857e-07,
      "loss": 0.0752,
      "mae_dtheta": 0.0314214713871479,
      "mae_dx": 0.01003577932715416,
      "mae_dy": 0.0029565799050033092,
      "pose_mae_dtheta": 0.2424984872341156,
      "pose_mae_dx": 0.07879012823104858,
      "pose_mae_dy": 0.03343158960342407,
      "pose_rmse_dtheta": 0.46591711044311523,
      "pose_rmse_dx": 0.1778160035610199,
      "pose_rmse_dy": 0.08960714191198349,
      "pose_rmse_mean": 0.2444467544555664,
      "rmse_dtheta": 0.05313226953148842,
      "rmse_dx": 0.021094616502523422,
      "rmse_dy": 0.0062743546441197395,
      "rmse_mean": 0.026833748444914818,
      "rotation_flip": 0.005382775329053402,
      "sparse_tokens": 27435.0,
      "step": 10662,
      "turn_loss": 0.20672015845775604,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.49540048318156477,
      "grad_norm": 0.8075226545333862,
      "learning_rate": 3.09730153307119e-07,
      "loss": 0.2469,
      "mae_dtheta": 0.039230383932590485,
      "mae_dx": 0.004892292898148298,
      "mae_dy": 0.004877988714724779,
      "pose_mae_dtheta": 0.26156261563301086,
      "pose_mae_dx": 0.03661997988820076,
      "pose_mae_dy": 0.049898531287908554,
      "pose_rmse_dtheta": 0.47139236330986023,
      "pose_rmse_dx": 0.07562281936407089,
      "pose_rmse_dy": 0.09358570724725723,
      "pose_rmse_mean": 0.21353363990783691,
      "rmse_dtheta": 0.05769507959485054,
      "rmse_dx": 0.012614551931619644,
      "rmse_dy": 0.00876576267182827,
      "rmse_mean": 0.0263584665954113,
      "rotation_flip": 0.015706805512309074,
      "sparse_tokens": 5940.0,
      "step": 10663,
      "turn_loss": 0.1761041283607483,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 36988.0,
      "epoch": 0.49544694294740754,
      "grad_norm": 0.3991874158382416,
      "learning_rate": 3.092721826891476e-07,
      "loss": 0.0999,
      "mae_dtheta": 0.03858812898397446,
      "mae_dx": 0.013681858777999878,
      "mae_dy": 0.005924718454480171,
      "pose_mae_dtheta": 0.28714320063591003,
      "pose_mae_dx": 0.10956671833992004,
      "pose_mae_dy": 0.0646393671631813,
      "pose_rmse_dtheta": 0.48862937092781067,
      "pose_rmse_dx": 0.22747424244880676,
      "pose_rmse_dy": 0.16964492201805115,
      "pose_rmse_mean": 0.2952495217323303,
      "rmse_dtheta": 0.05670129507780075,
      "rmse_dx": 0.02593602053821087,
      "rmse_dy": 0.01275019720196724,
      "rmse_mean": 0.031795840710401535,
      "rotation_flip": 0.015441959723830223,
      "sparse_tokens": 29305.0,
      "step": 10664,
      "turn_loss": 0.30447983741760254,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.4954934027132503,
      "grad_norm": 0.33137521147727966,
      "learning_rate": 3.088145400962911e-07,
      "loss": 0.0846,
      "mae_dtheta": 0.009707652032375336,
      "mae_dx": 0.0010780232260003686,
      "mae_dy": 0.0022902661003172398,
      "pose_mae_dtheta": 0.05972662940621376,
      "pose_mae_dx": 0.018314901739358902,
      "pose_mae_dy": 0.030542107298970222,
      "pose_rmse_dtheta": 0.1416916400194168,
      "pose_rmse_dx": 0.04746799170970917,
      "pose_rmse_dy": 0.07466749846935272,
      "pose_rmse_mean": 0.08794238418340683,
      "rmse_dtheta": 0.019181832671165466,
      "rmse_dx": 0.0036601971369236708,
      "rmse_dy": 0.004814359359443188,
      "rmse_mean": 0.009218796156346798,
      "rotation_flip": 0.0047961631789803505,
      "sparse_tokens": 32025.0,
      "step": 10665,
      "turn_loss": 0.0787448137998581,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4955398624790931,
      "grad_norm": 0.435752272605896,
      "learning_rate": 3.0835722556055103e-07,
      "loss": 0.072,
      "mae_dtheta": 0.008413662202656269,
      "mae_dx": 0.0013203273992985487,
      "mae_dy": 0.0017506586154922843,
      "pose_mae_dtheta": 0.05382907763123512,
      "pose_mae_dx": 0.018952729180455208,
      "pose_mae_dy": 0.024715229868888855,
      "pose_rmse_dtheta": 0.11568093299865723,
      "pose_rmse_dx": 0.052854131907224655,
      "pose_rmse_dy": 0.06105012074112892,
      "pose_rmse_mean": 0.076528400182724,
      "rmse_dtheta": 0.017575040459632874,
      "rmse_dx": 0.003986784722656012,
      "rmse_dy": 0.004172991029918194,
      "rmse_mean": 0.00857827253639698,
      "rotation_flip": 0.003799071302637458,
      "sparse_tokens": 32073.0,
      "step": 10666,
      "turn_loss": 0.06775912642478943,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4955863222449359,
      "grad_norm": 0.3199427127838135,
      "learning_rate": 3.0790023911390853e-07,
      "loss": 0.0745,
      "mae_dtheta": 0.008233455009758472,
      "mae_dx": 0.0013598520308732986,
      "mae_dy": 0.0013986413832753897,
      "pose_mae_dtheta": 0.058772068470716476,
      "pose_mae_dx": 0.015602748841047287,
      "pose_mae_dy": 0.020346350967884064,
      "pose_rmse_dtheta": 0.1732344925403595,
      "pose_rmse_dx": 0.044833146035671234,
      "pose_rmse_dy": 0.05727749690413475,
      "pose_rmse_mean": 0.09178172051906586,
      "rmse_dtheta": 0.02089221216738224,
      "rmse_dx": 0.004703880753368139,
      "rmse_dy": 0.003322090022265911,
      "rmse_mean": 0.009639395400881767,
      "rotation_flip": 0.0036496350076049566,
      "sparse_tokens": 32105.0,
      "step": 10667,
      "turn_loss": 0.055086567997932434,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.49563278201077865,
      "grad_norm": 0.5053892731666565,
      "learning_rate": 3.0744358078832024e-07,
      "loss": 0.0926,
      "mae_dtheta": 0.00896349549293518,
      "mae_dx": 0.001524865161627531,
      "mae_dy": 0.0017937665106728673,
      "pose_mae_dtheta": 0.05910089984536171,
      "pose_mae_dx": 0.01695469208061695,
      "pose_mae_dy": 0.02265605330467224,
      "pose_rmse_dtheta": 0.13579130172729492,
      "pose_rmse_dx": 0.047241806983947754,
      "pose_rmse_dy": 0.05091274529695511,
      "pose_rmse_mean": 0.07798194885253906,
      "rmse_dtheta": 0.018957166001200676,
      "rmse_dx": 0.005226220935583115,
      "rmse_dy": 0.003823855658993125,
      "rmse_mean": 0.009335747919976711,
      "rotation_flip": 0.003080985974520445,
      "sparse_tokens": 32105.0,
      "step": 10668,
      "turn_loss": 0.07012613862752914,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.4956792417766214,
      "grad_norm": 0.8890756964683533,
      "learning_rate": 3.069872506157212e-07,
      "loss": 0.1829,
      "mae_dtheta": 0.023432657122612,
      "mae_dx": 0.00822378695011139,
      "mae_dy": 0.0036270874552428722,
      "pose_mae_dtheta": 0.18179090321063995,
      "pose_mae_dx": 0.049842726439237595,
      "pose_mae_dy": 0.0432262159883976,
      "pose_rmse_dtheta": 0.31640711426734924,
      "pose_rmse_dx": 0.11494792252779007,
      "pose_rmse_dy": 0.12031196057796478,
      "pose_rmse_mean": 0.1838890016078949,
      "rmse_dtheta": 0.038035012781620026,
      "rmse_dx": 0.01829313114285469,
      "rmse_dy": 0.007429806049913168,
      "rmse_mean": 0.021252650767564774,
      "rotation_flip": 0.007534984033554792,
      "sparse_tokens": 14413.0,
      "step": 10669,
      "turn_loss": 0.22390076518058777,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4957257015424642,
      "grad_norm": 0.6530649662017822,
      "learning_rate": 3.0653124862802306e-07,
      "loss": 0.1413,
      "mae_dtheta": 0.0064572496339678764,
      "mae_dx": 0.0012668330455198884,
      "mae_dy": 0.0017214135732501745,
      "pose_mae_dtheta": 0.0434589758515358,
      "pose_mae_dx": 0.015114990994334221,
      "pose_mae_dy": 0.017405251041054726,
      "pose_rmse_dtheta": 0.12062373012304306,
      "pose_rmse_dx": 0.05032585561275482,
      "pose_rmse_dy": 0.04230795428156853,
      "pose_rmse_mean": 0.0710858479142189,
      "rmse_dtheta": 0.016502831131219864,
      "rmse_dx": 0.00455196900293231,
      "rmse_dy": 0.004376963246613741,
      "rmse_mean": 0.008477254770696163,
      "rotation_flip": 0.00913241971284151,
      "sparse_tokens": 32057.0,
      "step": 10670,
      "turn_loss": 0.05653437599539757,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.495772161308307,
      "grad_norm": 0.6513103246688843,
      "learning_rate": 3.060755748571137e-07,
      "loss": 0.1373,
      "mae_dtheta": 0.038006436079740524,
      "mae_dx": 0.010867936536669731,
      "mae_dy": 0.005342669319361448,
      "pose_mae_dtheta": 0.3264753520488739,
      "pose_mae_dx": 0.08030088990926743,
      "pose_mae_dy": 0.07003697752952576,
      "pose_rmse_dtheta": 0.5767979025840759,
      "pose_rmse_dx": 0.19218970835208893,
      "pose_rmse_dy": 0.15175938606262207,
      "pose_rmse_mean": 0.30691567063331604,
      "rmse_dtheta": 0.05633518844842911,
      "rmse_dx": 0.023611586540937424,
      "rmse_dy": 0.011618327349424362,
      "rmse_mean": 0.030521702021360397,
      "rotation_flip": 0.00918484479188919,
      "sparse_tokens": 14911.0,
      "step": 10671,
      "turn_loss": 0.27006062865257263,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.4958186210741498,
      "grad_norm": 0.7048907279968262,
      "learning_rate": 3.056202293348587e-07,
      "loss": 0.1446,
      "mae_dtheta": 0.02804199419915676,
      "mae_dx": 0.009331225417554379,
      "mae_dy": 0.004397145938128233,
      "pose_mae_dtheta": 0.19308513402938843,
      "pose_mae_dx": 0.07270009815692902,
      "pose_mae_dy": 0.07666879147291183,
      "pose_rmse_dtheta": 0.35731399059295654,
      "pose_rmse_dx": 0.17630602419376373,
      "pose_rmse_dy": 0.1662517488002777,
      "pose_rmse_mean": 0.23329059779644012,
      "rmse_dtheta": 0.04435192048549652,
      "rmse_dx": 0.02156122587621212,
      "rmse_dy": 0.007651337888091803,
      "rmse_mean": 0.024521496146917343,
      "rotation_flip": 0.020280811935663223,
      "sparse_tokens": 12395.0,
      "step": 10672,
      "turn_loss": 0.20498301088809967,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.4958650808399926,
      "grad_norm": 0.5611624717712402,
      "learning_rate": 3.051652120931003e-07,
      "loss": 0.1416,
      "mae_dtheta": 0.030531687662005424,
      "mae_dx": 0.011500918306410313,
      "mae_dy": 0.005061750765889883,
      "pose_mae_dtheta": 0.2463940680027008,
      "pose_mae_dx": 0.08668733388185501,
      "pose_mae_dy": 0.0613224022090435,
      "pose_rmse_dtheta": 0.3972425162792206,
      "pose_rmse_dx": 0.2319730967283249,
      "pose_rmse_dy": 0.1359216421842575,
      "pose_rmse_mean": 0.2550457715988159,
      "rmse_dtheta": 0.04642762988805771,
      "rmse_dx": 0.024738091975450516,
      "rmse_dy": 0.009703373536467552,
      "rmse_mean": 0.02695636823773384,
      "rotation_flip": 0.011940298601984978,
      "sparse_tokens": 5862.0,
      "step": 10673,
      "turn_loss": 0.2670404613018036,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.49591154060583537,
      "grad_norm": 0.3751753866672516,
      "learning_rate": 3.0471052316365934e-07,
      "loss": 0.0785,
      "mae_dtheta": 0.014175698161125183,
      "mae_dx": 0.003628215054050088,
      "mae_dy": 0.002925348933786154,
      "pose_mae_dtheta": 0.10632878541946411,
      "pose_mae_dx": 0.03745143488049507,
      "pose_mae_dy": 0.03019566275179386,
      "pose_rmse_dtheta": 0.29240357875823975,
      "pose_rmse_dx": 0.12295915931463242,
      "pose_rmse_dy": 0.08304363489151001,
      "pose_rmse_mean": 0.16613546013832092,
      "rmse_dtheta": 0.03319847211241722,
      "rmse_dx": 0.011469678953289986,
      "rmse_dy": 0.007854038849473,
      "rmse_mean": 0.017507396638393402,
      "rotation_flip": 0.008184881880879402,
      "sparse_tokens": 32089.0,
      "step": 10674,
      "turn_loss": 0.1130514070391655,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.49595800037167814,
      "grad_norm": 0.44235917925834656,
      "learning_rate": 3.042561625783308e-07,
      "loss": 0.0843,
      "mae_dtheta": 0.037560708820819855,
      "mae_dx": 0.017651230096817017,
      "mae_dy": 0.004755603615194559,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44235917925834656,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 142.32171630859375,
      "model/head/act_norm_mean": 107.76027134486607,
      "model/head/act_norm_min": 76.72239685058594,
      "model/head/act_over_embed": 74.05386733574726,
      "model/head/grad_frac": 0.1072712317109108,
      "model/head/grad_norm": 0.047452412545681,
      "model/head/grad_zero_frac": 0.0001611740590305999,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6904994419642857,
      "model/head/update_ratio": 0.0008077918319031596,
      "model/head/weight_delta": 9.974719047546387,
      "model/head/weight_delta_rel": 0.1749861240386963,
      "model/head/weight_norm": 58.74336624145508,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228803515434265,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228411038716634,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227990508079529,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29058036528139186,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11541003733873367,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05105268955230713,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.550390625,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001648461096920073,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1546695232391357,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.103072889149189,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96990966796875,
      "model/modality_embedder/grad_frac": 0.11541003733873367,
      "model/modality_embedder/grad_norm": 0.05105268955230713,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.550390625,
      "model/modality_embedder/update_ratio": 0.001648461096920073,
      "model/modality_embedder/weight_delta": 3.1546695232391357,
      "model/modality_embedder/weight_delta_rel": 0.103072889149189,
      "model/modality_embedder/weight_norm": 30.96990966796875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.21247863769531,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.564399978741495,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.529494285583496,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.193676278779577,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06100935488939285,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02698804810643196,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.000965236104093492,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7369275093078613,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09973528981208801,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96004867553711,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.46226501464844,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.368553801729025,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.987458229064941,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.746298314543314,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05958385020494461,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.026357462629675865,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008854090701788664,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.469759702682495,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1201951876282692,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76868438720703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.18603515625,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.880376629818596,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.491584777832031,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.785237115914782,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06882594525814056,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03044578991830349,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009904213948175311,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7589807510375977,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12621954083442688,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.7402400970459,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.23458862304688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.685608878968253,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.750679969787598,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.02580961838102,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07582632452249527,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03354246914386749,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011198038700968027,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.230682134628296,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11040938645601273,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95387840270996,
      "model/normalizer/grad_frac": 0.2854999899864197,
      "model/normalizer/grad_norm": 0.12629354000091553,
      "model/normalizer/grad_zero_frac": 0.00020916770154144615,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016056506428867579,
      "model/normalizer/weight_delta": 6.795083999633789,
      "model/normalizer/weight_delta_rel": 0.08751674741506577,
      "model/normalizer/weight_norm": 78.65567779541016,
      "pose_mae_dtheta": 0.2523334324359894,
      "pose_mae_dx": 0.13191501796245575,
      "pose_mae_dy": 0.05951685085892677,
      "pose_rmse_dtheta": 0.429583340883255,
      "pose_rmse_dx": 0.28521355986595154,
      "pose_rmse_dy": 0.15203887224197388,
      "pose_rmse_mean": 0.2889452576637268,
      "rmse_dtheta": 0.054338499903678894,
      "rmse_dx": 0.03218930959701538,
      "rmse_dy": 0.009029578417539597,
      "rmse_mean": 0.031852465122938156,
      "rotation_flip": 0.008583690971136093,
      "sparse_tokens": 3877.0,
      "step": 10675,
      "turn_loss": 0.2695636451244354,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.4960044601375209,
      "grad_norm": 0.5501689910888672,
      "learning_rate": 3.0380213036888926e-07,
      "loss": 0.1107,
      "mae_dtheta": 0.03673764690756798,
      "mae_dx": 0.011903387494385242,
      "mae_dy": 0.0062531596049666405,
      "pose_mae_dtheta": 0.2766374349594116,
      "pose_mae_dx": 0.08052409440279007,
      "pose_mae_dy": 0.04918244108557701,
      "pose_rmse_dtheta": 0.4951283633708954,
      "pose_rmse_dx": 0.20518483221530914,
      "pose_rmse_dy": 0.15701477229595184,
      "pose_rmse_mean": 0.2857760190963745,
      "rmse_dtheta": 0.058330193161964417,
      "rmse_dx": 0.025024285539984703,
      "rmse_dy": 0.015988964587450027,
      "rmse_mean": 0.0331144854426384,
      "rotation_flip": 0.015697138383984566,
      "sparse_tokens": 18540.0,
      "step": 10676,
      "turn_loss": 0.29267585277557373,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 20453.0,
      "epoch": 0.4960509199033637,
      "grad_norm": 0.9442729353904724,
      "learning_rate": 3.0334842656708605e-07,
      "loss": 0.3188,
      "mae_dtheta": 0.035810813307762146,
      "mae_dx": 0.011565983295440674,
      "mae_dy": 0.0039675855077803135,
      "pose_mae_dtheta": 0.27955055236816406,
      "pose_mae_dx": 0.09006958454847336,
      "pose_mae_dy": 0.04949849098920822,
      "pose_rmse_dtheta": 0.5113963484764099,
      "pose_rmse_dx": 0.2161443531513214,
      "pose_rmse_dy": 0.1139405220746994,
      "pose_rmse_mean": 0.28049376606941223,
      "rmse_dtheta": 0.056262992322444916,
      "rmse_dx": 0.024252794682979584,
      "rmse_dy": 0.007733423262834549,
      "rmse_mean": 0.0294164028018713,
      "rotation_flip": 0.010101010091602802,
      "sparse_tokens": 15448.0,
      "step": 10677,
      "turn_loss": 0.264701247215271,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.4960973796692065,
      "grad_norm": 1.108906626701355,
      "learning_rate": 3.0289505120464743e-07,
      "loss": 0.2369,
      "mae_dtheta": 0.031490422785282135,
      "mae_dx": 0.011698192916810513,
      "mae_dy": 0.004659582395106554,
      "pose_mae_dtheta": 0.24243438243865967,
      "pose_mae_dx": 0.09020312875509262,
      "pose_mae_dy": 0.06197768449783325,
      "pose_rmse_dtheta": 0.4312104284763336,
      "pose_rmse_dx": 0.215715229511261,
      "pose_rmse_dy": 0.16132281720638275,
      "pose_rmse_mean": 0.2694161832332611,
      "rmse_dtheta": 0.049773652106523514,
      "rmse_dx": 0.024345707148313522,
      "rmse_dy": 0.010225523263216019,
      "rmse_mean": 0.028114959597587585,
      "rotation_flip": 0.016765285283327103,
      "sparse_tokens": 18934.0,
      "step": 10678,
      "turn_loss": 0.27416110038757324,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.49614383943504925,
      "grad_norm": 0.4247100353240967,
      "learning_rate": 3.0244200431327976e-07,
      "loss": 0.1206,
      "mae_dtheta": 0.007032611407339573,
      "mae_dx": 0.0016924494411796331,
      "mae_dy": 0.0013588699512183666,
      "pose_mae_dtheta": 0.04739111661911011,
      "pose_mae_dx": 0.01602235622704029,
      "pose_mae_dy": 0.01505039632320404,
      "pose_rmse_dtheta": 0.1612100601196289,
      "pose_rmse_dx": 0.0466073602437973,
      "pose_rmse_dy": 0.041699282824993134,
      "pose_rmse_mean": 0.08317223191261292,
      "rmse_dtheta": 0.021043578162789345,
      "rmse_dx": 0.005887435283511877,
      "rmse_dy": 0.0046299295499920845,
      "rmse_mean": 0.010520314797759056,
      "rotation_flip": 0.0055555556900799274,
      "sparse_tokens": 32089.0,
      "step": 10679,
      "turn_loss": 0.07240162789821625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3279.0,
      "epoch": 0.496190299200892,
      "grad_norm": 0.5808296203613281,
      "learning_rate": 3.0198928592466317e-07,
      "loss": 0.1306,
      "mae_dtheta": 0.017932135611772537,
      "mae_dx": 0.009528559632599354,
      "mae_dy": 0.006725073326379061,
      "pose_mae_dtheta": 0.08880438655614853,
      "pose_mae_dx": 0.08241113275289536,
      "pose_mae_dy": 0.05186360329389572,
      "pose_rmse_dtheta": 0.15197867155075073,
      "pose_rmse_dx": 0.1970624327659607,
      "pose_rmse_dy": 0.13088558614253998,
      "pose_rmse_mean": 0.1599755734205246,
      "rmse_dtheta": 0.03280482068657875,
      "rmse_dx": 0.021400190889835358,
      "rmse_dy": 0.013403233140707016,
      "rmse_mean": 0.022536082193255424,
      "rotation_flip": 0.0060240961611270905,
      "sparse_tokens": 2966.0,
      "step": 10680,
      "turn_loss": 0.2515784800052643,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4962367589667348,
      "grad_norm": 0.5060532689094543,
      "learning_rate": 3.015368960704584e-07,
      "loss": 0.1025,
      "mae_dtheta": 0.007868070155382156,
      "mae_dx": 0.0016731377691030502,
      "mae_dy": 0.002060995902866125,
      "pose_mae_dtheta": 0.047782327979803085,
      "pose_mae_dx": 0.018098678439855576,
      "pose_mae_dy": 0.017515288665890694,
      "pose_rmse_dtheta": 0.11324440687894821,
      "pose_rmse_dx": 0.04738811030983925,
      "pose_rmse_dy": 0.04054931551218033,
      "pose_rmse_mean": 0.06706061214208603,
      "rmse_dtheta": 0.018907897174358368,
      "rmse_dx": 0.004636332858353853,
      "rmse_dy": 0.005229170899838209,
      "rmse_mean": 0.009591134265065193,
      "rotation_flip": 0.0036900369450449944,
      "sparse_tokens": 32185.0,
      "step": 10681,
      "turn_loss": 0.07905510812997818,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.4962832187325776,
      "grad_norm": 0.7017404437065125,
      "learning_rate": 3.010848347822992e-07,
      "loss": 0.1281,
      "mae_dtheta": 0.01730584353208542,
      "mae_dx": 0.004718807525932789,
      "mae_dy": 0.0029680219013243914,
      "pose_mae_dtheta": 0.10394815355539322,
      "pose_mae_dx": 0.038758061826229095,
      "pose_mae_dy": 0.04289981722831726,
      "pose_rmse_dtheta": 0.16843704879283905,
      "pose_rmse_dx": 0.0738343819975853,
      "pose_rmse_dy": 0.08555637300014496,
      "pose_rmse_mean": 0.1092759370803833,
      "rmse_dtheta": 0.02770472690463066,
      "rmse_dx": 0.009882799349725246,
      "rmse_dy": 0.005753222852945328,
      "rmse_mean": 0.014446916989982128,
      "rotation_flip": 0.019354838877916336,
      "sparse_tokens": 2872.0,
      "step": 10682,
      "turn_loss": 0.22445908188819885,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 36550.0,
      "epoch": 0.49632967849842036,
      "grad_norm": 0.8392552733421326,
      "learning_rate": 3.006331020918002e-07,
      "loss": 0.1959,
      "mae_dtheta": 0.03266347572207451,
      "mae_dx": 0.012754669412970543,
      "mae_dy": 0.005047105718404055,
      "pose_mae_dtheta": 0.26035192608833313,
      "pose_mae_dx": 0.09455741196870804,
      "pose_mae_dy": 0.06878703087568283,
      "pose_rmse_dtheta": 0.46044081449508667,
      "pose_rmse_dx": 0.2069069743156433,
      "pose_rmse_dy": 0.17263075709342957,
      "pose_rmse_mean": 0.27999287843704224,
      "rmse_dtheta": 0.050105415284633636,
      "rmse_dx": 0.025469206273555756,
      "rmse_dy": 0.009884357452392578,
      "rmse_mean": 0.028486326336860657,
      "rotation_flip": 0.014962593093514442,
      "sparse_tokens": 26265.0,
      "step": 10683,
      "turn_loss": 0.23794719576835632,
      "turns": 113.0,
      "turns_per_sample": 113.0
    },
    {
      "dense_tokens": 33310.0,
      "epoch": 0.49637613826426313,
      "grad_norm": 0.7443177700042725,
      "learning_rate": 3.001816980305505e-07,
      "loss": 0.2246,
      "mae_dtheta": 0.031479161232709885,
      "mae_dx": 0.011132328771054745,
      "mae_dy": 0.005101017188280821,
      "pose_mae_dtheta": 0.2448502629995346,
      "pose_mae_dx": 0.08767897635698318,
      "pose_mae_dy": 0.05739093944430351,
      "pose_rmse_dtheta": 0.43433132767677307,
      "pose_rmse_dx": 0.2049989551305771,
      "pose_rmse_dy": 0.13576385378837585,
      "pose_rmse_mean": 0.258364737033844,
      "rmse_dtheta": 0.04922616854310036,
      "rmse_dx": 0.02348778024315834,
      "rmse_dy": 0.010614369995892048,
      "rmse_mean": 0.02777610719203949,
      "rotation_flip": 0.0082023236900568,
      "sparse_tokens": 26507.0,
      "step": 10684,
      "turn_loss": 0.256904661655426,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.4964225980301059,
      "grad_norm": 0.558406412601471,
      "learning_rate": 2.997306226301172e-07,
      "loss": 0.1668,
      "mae_dtheta": 0.03733811900019646,
      "mae_dx": 0.01135020051151514,
      "mae_dy": 0.0059160152450203896,
      "pose_mae_dtheta": 0.31632018089294434,
      "pose_mae_dx": 0.0933912843465805,
      "pose_mae_dy": 0.06628858298063278,
      "pose_rmse_dtheta": 0.5551632642745972,
      "pose_rmse_dx": 0.20274020731449127,
      "pose_rmse_dy": 0.17537233233451843,
      "pose_rmse_mean": 0.31109195947647095,
      "rmse_dtheta": 0.05704876035451889,
      "rmse_dx": 0.02344433031976223,
      "rmse_dy": 0.01315228920429945,
      "rmse_mean": 0.031215127557516098,
      "rotation_flip": 0.004724409431219101,
      "sparse_tokens": 20771.0,
      "step": 10685,
      "turn_loss": 0.33116257190704346,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.4964690577959487,
      "grad_norm": 0.37488943338394165,
      "learning_rate": 2.99279875922045e-07,
      "loss": 0.1253,
      "mae_dtheta": 0.04614222049713135,
      "mae_dx": 0.004954110365360975,
      "mae_dy": 0.00146252301055938,
      "pose_mae_dtheta": 0.40826216340065,
      "pose_mae_dx": 0.04325588047504425,
      "pose_mae_dy": 0.014867976307868958,
      "pose_rmse_dtheta": 0.6627159118652344,
      "pose_rmse_dx": 0.12289692461490631,
      "pose_rmse_dy": 0.04378160089254379,
      "pose_rmse_mean": 0.2764648199081421,
      "rmse_dtheta": 0.06531792134046555,
      "rmse_dx": 0.013325769454240799,
      "rmse_dy": 0.0036697417963296175,
      "rmse_mean": 0.027437811717391014,
      "rotation_flip": 0.012248468585312366,
      "sparse_tokens": 18205.0,
      "step": 10686,
      "turn_loss": 0.26346516609191895,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.49651551756179146,
      "grad_norm": 0.4358240067958832,
      "learning_rate": 2.988294579378537e-07,
      "loss": 0.0936,
      "mae_dtheta": 0.009201209992170334,
      "mae_dx": 0.0019007602240890265,
      "mae_dy": 0.0019380170851945877,
      "pose_mae_dtheta": 0.06397171318531036,
      "pose_mae_dx": 0.021080145612359047,
      "pose_mae_dy": 0.021311843767762184,
      "pose_rmse_dtheta": 0.16900141537189484,
      "pose_rmse_dx": 0.06158032640814781,
      "pose_rmse_dy": 0.05705723538994789,
      "pose_rmse_mean": 0.09587966650724411,
      "rmse_dtheta": 0.021497320383787155,
      "rmse_dx": 0.00600415887311101,
      "rmse_dy": 0.00460096076130867,
      "rmse_mean": 0.010700813494622707,
      "rotation_flip": 0.004012036137282848,
      "sparse_tokens": 32089.0,
      "step": 10687,
      "turn_loss": 0.08022407442331314,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4965619773276343,
      "grad_norm": 0.35388603806495667,
      "learning_rate": 2.9837936870904137e-07,
      "loss": 0.0599,
      "mae_dtheta": 0.004894209560006857,
      "mae_dx": 0.0008714221767149866,
      "mae_dy": 0.00027719378704205155,
      "pose_mae_dtheta": 0.03461343050003052,
      "pose_mae_dx": 0.006520482711493969,
      "pose_mae_dy": 0.003731727134436369,
      "pose_rmse_dtheta": 0.18924692273139954,
      "pose_rmse_dx": 0.019639380276203156,
      "pose_rmse_dy": 0.009809940122067928,
      "pose_rmse_mean": 0.0728987455368042,
      "rmse_dtheta": 0.02238897979259491,
      "rmse_dx": 0.0027168800588697195,
      "rmse_dy": 0.000678835844155401,
      "rmse_mean": 0.008594898506999016,
      "rotation_flip": 0.0021739129442721605,
      "sparse_tokens": 32137.0,
      "step": 10688,
      "turn_loss": 0.028314055874943733,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4966084370934771,
      "grad_norm": 0.3413732349872589,
      "learning_rate": 2.979296082670835e-07,
      "loss": 0.0665,
      "mae_dtheta": 0.007552257739007473,
      "mae_dx": 0.0009921678574755788,
      "mae_dy": 0.0016853256383910775,
      "pose_mae_dtheta": 0.05077015981078148,
      "pose_mae_dx": 0.0138251893222332,
      "pose_mae_dy": 0.02466343156993389,
      "pose_rmse_dtheta": 0.09568355977535248,
      "pose_rmse_dx": 0.03277050703763962,
      "pose_rmse_dy": 0.0628705620765686,
      "pose_rmse_mean": 0.06377487629652023,
      "rmse_dtheta": 0.014229102060198784,
      "rmse_dx": 0.0036161006428301334,
      "rmse_dy": 0.0034404899924993515,
      "rmse_mean": 0.007095230743288994,
      "rotation_flip": 0.005374280270189047,
      "sparse_tokens": 32057.0,
      "step": 10689,
      "turn_loss": 0.060732267796993256,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.49665489685931985,
      "grad_norm": 0.8617303371429443,
      "learning_rate": 2.974801766434315e-07,
      "loss": 0.2536,
      "mae_dtheta": 0.02201031893491745,
      "mae_dx": 0.010811046697199345,
      "mae_dy": 0.0036547917407006025,
      "pose_mae_dtheta": 0.12730132043361664,
      "pose_mae_dx": 0.07924094796180725,
      "pose_mae_dy": 0.035907696932554245,
      "pose_rmse_dtheta": 0.2398080974817276,
      "pose_rmse_dx": 0.20127829909324646,
      "pose_rmse_dy": 0.09045366197824478,
      "pose_rmse_mean": 0.17718003690242767,
      "rmse_dtheta": 0.039093825966119766,
      "rmse_dx": 0.02427474968135357,
      "rmse_dy": 0.00761362025514245,
      "rmse_mean": 0.023660732433199883,
      "rotation_flip": 0.017667844891548157,
      "sparse_tokens": 4211.0,
      "step": 10690,
      "turn_loss": 0.2168162763118744,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.4967013566251626,
      "grad_norm": 0.418846994638443,
      "learning_rate": 2.9703107386951535e-07,
      "loss": 0.1056,
      "mae_dtheta": 0.02588864602148533,
      "mae_dx": 0.007736261934041977,
      "mae_dy": 0.0029516848735511303,
      "pose_mae_dtheta": 0.19737613201141357,
      "pose_mae_dx": 0.06386973708868027,
      "pose_mae_dy": 0.03558580204844475,
      "pose_rmse_dtheta": 0.4294852316379547,
      "pose_rmse_dx": 0.1914864033460617,
      "pose_rmse_dy": 0.10218232125043869,
      "pose_rmse_mean": 0.2410513162612915,
      "rmse_dtheta": 0.048157986253499985,
      "rmse_dx": 0.02030114457011223,
      "rmse_dy": 0.00700279138982296,
      "rmse_mean": 0.025153975933790207,
      "rotation_flip": 0.011029412038624287,
      "sparse_tokens": 10233.0,
      "step": 10691,
      "turn_loss": 0.1534014493227005,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.4967478163910054,
      "grad_norm": 0.5523576140403748,
      "learning_rate": 2.965822999767398e-07,
      "loss": 0.14,
      "mae_dtheta": 0.03316473960876465,
      "mae_dx": 0.01544251013547182,
      "mae_dy": 0.0037759270053356886,
      "pose_mae_dtheta": 0.25003743171691895,
      "pose_mae_dx": 0.12832553684711456,
      "pose_mae_dy": 0.04653531312942505,
      "pose_rmse_dtheta": 0.43135327100753784,
      "pose_rmse_dx": 0.27861467003822327,
      "pose_rmse_dy": 0.10554184764623642,
      "pose_rmse_mean": 0.27183660864830017,
      "rmse_dtheta": 0.04938417300581932,
      "rmse_dx": 0.02963285893201828,
      "rmse_dy": 0.007045224774628878,
      "rmse_mean": 0.02868741750717163,
      "rotation_flip": 0.011342154815793037,
      "sparse_tokens": 9411.0,
      "step": 10692,
      "turn_loss": 0.2248896211385727,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.4967942761568482,
      "grad_norm": 1.065861701965332,
      "learning_rate": 2.9613385499648926e-07,
      "loss": 0.2634,
      "mae_dtheta": 0.03971274197101593,
      "mae_dx": 0.011324330233037472,
      "mae_dy": 0.004786065313965082,
      "pose_mae_dtheta": 0.31613388657569885,
      "pose_mae_dx": 0.0846230611205101,
      "pose_mae_dy": 0.051853738725185394,
      "pose_rmse_dtheta": 0.5448517203330994,
      "pose_rmse_dx": 0.19628261029720306,
      "pose_rmse_dy": 0.11879867315292358,
      "pose_rmse_mean": 0.2866443395614624,
      "rmse_dtheta": 0.05946580320596695,
      "rmse_dx": 0.023196494206786156,
      "rmse_dy": 0.009912701323628426,
      "rmse_mean": 0.03085833415389061,
      "rotation_flip": 0.014634146355092525,
      "sparse_tokens": 13331.0,
      "step": 10693,
      "turn_loss": 0.31682005524635315,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.49684073592269096,
      "grad_norm": 0.3783509135246277,
      "learning_rate": 2.95685738960122e-07,
      "loss": 0.0968,
      "mae_dtheta": 0.007614415138959885,
      "mae_dx": 0.002130473731085658,
      "mae_dy": 0.002857087878510356,
      "pose_mae_dtheta": 0.04942925646901131,
      "pose_mae_dx": 0.02477060817182064,
      "pose_mae_dy": 0.02534542605280876,
      "pose_rmse_dtheta": 0.10528134554624557,
      "pose_rmse_dx": 0.08137115836143494,
      "pose_rmse_dy": 0.0538485087454319,
      "pose_rmse_mean": 0.0801670104265213,
      "rmse_dtheta": 0.015351388603448868,
      "rmse_dx": 0.00727744260802865,
      "rmse_dy": 0.007213421165943146,
      "rmse_mean": 0.009947417303919792,
      "rotation_flip": 0.004615384619683027,
      "sparse_tokens": 32089.0,
      "step": 10694,
      "turn_loss": 0.07304909080266953,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.49688719568853373,
      "grad_norm": 0.41116535663604736,
      "learning_rate": 2.952379518989762e-07,
      "loss": 0.0989,
      "mae_dtheta": 0.008065076544880867,
      "mae_dx": 0.0014707352966070175,
      "mae_dy": 0.0009741628891788423,
      "pose_mae_dtheta": 0.05030530318617821,
      "pose_mae_dx": 0.014509796164929867,
      "pose_mae_dy": 0.012489113956689835,
      "pose_rmse_dtheta": 0.1464904397726059,
      "pose_rmse_dx": 0.04260190948843956,
      "pose_rmse_dy": 0.036422811448574066,
      "pose_rmse_mean": 0.07517172396183014,
      "rmse_dtheta": 0.02257622592151165,
      "rmse_dx": 0.004997217562049627,
      "rmse_dy": 0.002598386723548174,
      "rmse_mean": 0.010057277046144009,
      "rotation_flip": 0.0038975500501692295,
      "sparse_tokens": 32137.0,
      "step": 10695,
      "turn_loss": 0.06609567254781723,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.4969336554543765,
      "grad_norm": 0.6350880265235901,
      "learning_rate": 2.947904938443663e-07,
      "loss": 0.0768,
      "mae_dtheta": 0.04862126708030701,
      "mae_dx": 0.008602745831012726,
      "mae_dy": 0.0023340138141065836,
      "pose_mae_dtheta": 0.40037888288497925,
      "pose_mae_dx": 0.07632807642221451,
      "pose_mae_dy": 0.028691047802567482,
      "pose_rmse_dtheta": 0.6724975109100342,
      "pose_rmse_dx": 0.15530890226364136,
      "pose_rmse_dy": 0.06586623936891556,
      "pose_rmse_mean": 0.29789090156555176,
      "rmse_dtheta": 0.07039465010166168,
      "rmse_dx": 0.018759746104478836,
      "rmse_dy": 0.004549946635961533,
      "rmse_mean": 0.031234782189130783,
      "rotation_flip": 0.019138755276799202,
      "sparse_tokens": 6984.0,
      "step": 10696,
      "turn_loss": 0.3009961247444153,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.4969801152202193,
      "grad_norm": 0.3968135118484497,
      "learning_rate": 2.943433648275823e-07,
      "loss": 0.1139,
      "mae_dtheta": 0.007505596149712801,
      "mae_dx": 0.0012879546266049147,
      "mae_dy": 0.0010422645136713982,
      "pose_mae_dtheta": 0.05244651436805725,
      "pose_mae_dx": 0.01059694029390812,
      "pose_mae_dy": 0.013435570523142815,
      "pose_rmse_dtheta": 0.19008298218250275,
      "pose_rmse_dx": 0.02797088213264942,
      "pose_rmse_dy": 0.03352266177535057,
      "pose_rmse_mean": 0.08385884016752243,
      "rmse_dtheta": 0.02213841862976551,
      "rmse_dx": 0.004332570359110832,
      "rmse_dy": 0.002269329968839884,
      "rmse_mean": 0.009580106474459171,
      "rotation_flip": 0.001693480066023767,
      "sparse_tokens": 32185.0,
      "step": 10697,
      "turn_loss": 0.053784288465976715,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.49702657498606206,
      "grad_norm": 0.48673519492149353,
      "learning_rate": 2.938965648798925e-07,
      "loss": 0.0953,
      "mae_dtheta": 0.03215457499027252,
      "mae_dx": 0.018154894933104515,
      "mae_dy": 0.0007265628664754331,
      "pose_mae_dtheta": 0.24845921993255615,
      "pose_mae_dx": 0.14748087525367737,
      "pose_mae_dy": 0.005421500187367201,
      "pose_rmse_dtheta": 0.5556150078773499,
      "pose_rmse_dx": 0.3355526924133301,
      "pose_rmse_dy": 0.011513573117554188,
      "pose_rmse_mean": 0.30089378356933594,
      "rmse_dtheta": 0.058615121990442276,
      "rmse_dx": 0.033874157816171646,
      "rmse_dy": 0.0018064866308122873,
      "rmse_mean": 0.03143192455172539,
      "rotation_flip": 0.006896551698446274,
      "sparse_tokens": 3166.0,
      "step": 10698,
      "turn_loss": 0.17406629025936127,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.49707303475190484,
      "grad_norm": 0.42249152064323425,
      "learning_rate": 2.934500940325413e-07,
      "loss": 0.1,
      "mae_dtheta": 0.03084668330848217,
      "mae_dx": 0.013532650656998158,
      "mae_dy": 0.009072815999388695,
      "pose_mae_dtheta": 0.19557374715805054,
      "pose_mae_dx": 0.10214149951934814,
      "pose_mae_dy": 0.10047359764575958,
      "pose_rmse_dtheta": 0.34869271516799927,
      "pose_rmse_dx": 0.1942308098077774,
      "pose_rmse_dy": 0.2130122184753418,
      "pose_rmse_mean": 0.2519785761833191,
      "rmse_dtheta": 0.04797087237238884,
      "rmse_dx": 0.024733012542128563,
      "rmse_dy": 0.015380507335066795,
      "rmse_mean": 0.029361464083194733,
      "rotation_flip": 0.019370460882782936,
      "sparse_tokens": 6936.0,
      "step": 10699,
      "turn_loss": 0.2978372573852539,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.4971194945177476,
      "grad_norm": 0.46726730465888977,
      "learning_rate": 2.930039523167522e-07,
      "loss": 0.0923,
      "mae_dtheta": 0.0047349645756185055,
      "mae_dx": 0.0009437645203433931,
      "mae_dy": 0.000601540319621563,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.46726733446121216,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 169.34588623046875,
      "model/head/act_norm_mean": 128.16135969065655,
      "model/head/act_norm_min": 76.03439331054688,
      "model/head/act_over_embed": 88.07368624497279,
      "model/head/grad_frac": 0.10321175307035446,
      "model/head/grad_norm": 0.04822748154401779,
      "model/head/grad_zero_frac": 0.0001767203793860972,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6981386126893939,
      "model/head/update_ratio": 0.0008209852385334671,
      "model/head/weight_delta": 9.975381851196289,
      "model/head/weight_delta_rel": 0.1749977469444275,
      "model/head/weight_norm": 58.7434196472168,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229110777378082,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42284473973748965,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42277342081069946,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905828638824272,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09090109169483185,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04247511178255081,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5491206635462555,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001371494261547923,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1546518802642822,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10307230800390244,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969951629638672,
      "model/modality_embedder/grad_frac": 0.09090109169483185,
      "model/modality_embedder/grad_norm": 0.04247511178255081,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5491206635462555,
      "model/modality_embedder/update_ratio": 0.001371494261547923,
      "model/modality_embedder/weight_delta": 3.1546518802642822,
      "model/modality_embedder/weight_delta_rel": 0.10307230800390244,
      "model/modality_embedder/weight_norm": 30.969951629638672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 93.15992736816406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.36947350489017,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.039632797241211,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.43413970531355,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06826110929250717,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.031896185129880905,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001140774111263454,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7372655868530273,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09974761307239532,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96012306213379,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 94.82063293457031,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.38150853775854,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.277643203735352,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.12961965472195,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07372868806123734,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03445100784301758,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001157284714281559,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.470264434814453,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12021267414093018,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76882553100586,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 97.0223159790039,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.21509990780824,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.07042407989502,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.389680810572973,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08209345489740372,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.038359589874744415,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001247855369001627,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7595014572143555,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12623701989650726,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.740413665771484,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 97.74769592285156,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.835770903479236,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.192913055419922,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.503421091758998,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08950856328010559,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.041824426501989365,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.00139628816395998,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2311513423919678,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1104254201054573,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954008102416992,
      "model/normalizer/grad_frac": 0.3426383435726166,
      "model/normalizer/grad_norm": 0.1601037085056305,
      "model/normalizer/grad_zero_frac": 0.0002328024711459875,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020354967564344406,
      "model/normalizer/weight_delta": 6.796029567718506,
      "model/normalizer/weight_delta_rel": 0.08752892911434174,
      "model/normalizer/weight_norm": 78.65583801269531,
      "pose_mae_dtheta": 0.033495981246232986,
      "pose_mae_dx": 0.008444235660135746,
      "pose_mae_dy": 0.009149424731731415,
      "pose_rmse_dtheta": 0.12698237597942352,
      "pose_rmse_dx": 0.022211316972970963,
      "pose_rmse_dy": 0.02332146093249321,
      "pose_rmse_mean": 0.057505052536726,
      "rmse_dtheta": 0.016835343092679977,
      "rmse_dx": 0.003072331426665187,
      "rmse_dy": 0.001378917135298252,
      "rmse_mean": 0.00709553062915802,
      "rotation_flip": 0.002601456828415394,
      "sparse_tokens": 32137.0,
      "step": 10700,
      "turn_loss": 0.03379335254430771,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4971659542835904,
      "grad_norm": 0.5662577748298645,
      "learning_rate": 2.9255813976372227e-07,
      "loss": 0.0806,
      "mae_dtheta": 0.011033202521502972,
      "mae_dx": 0.0011671066749840975,
      "mae_dy": 0.0022410121746361256,
      "pose_mae_dtheta": 0.07034245133399963,
      "pose_mae_dx": 0.019561024382710457,
      "pose_mae_dy": 0.030986281111836433,
      "pose_rmse_dtheta": 0.14703787863254547,
      "pose_rmse_dx": 0.047192562371492386,
      "pose_rmse_dy": 0.060644861310720444,
      "pose_rmse_mean": 0.08495843410491943,
      "rmse_dtheta": 0.021978028118610382,
      "rmse_dx": 0.0036072665825486183,
      "rmse_dy": 0.004352832678705454,
      "rmse_mean": 0.009979375638067722,
      "rotation_flip": 0.004611564334481955,
      "sparse_tokens": 32073.0,
      "step": 10701,
      "turn_loss": 0.08957017213106155,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.49721241404943317,
      "grad_norm": 0.5133146643638611,
      "learning_rate": 2.9211265640462837e-07,
      "loss": 0.1573,
      "mae_dtheta": 0.00866185873746872,
      "mae_dx": 0.002552406396716833,
      "mae_dy": 0.0024882869329303503,
      "pose_mae_dtheta": 0.0553121343255043,
      "pose_mae_dx": 0.024050796404480934,
      "pose_mae_dy": 0.023109449073672295,
      "pose_rmse_dtheta": 0.1289706826210022,
      "pose_rmse_dx": 0.06502242386341095,
      "pose_rmse_dy": 0.057747982442379,
      "pose_rmse_mean": 0.08391369879245758,
      "rmse_dtheta": 0.020576579496264458,
      "rmse_dx": 0.007595390547066927,
      "rmse_dy": 0.006425531581044197,
      "rmse_mean": 0.011532500386238098,
      "rotation_flip": 0.00949503667652607,
      "sparse_tokens": 32089.0,
      "step": 10702,
      "turn_loss": 0.08641645312309265,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.49725887381527595,
      "grad_norm": 0.7166609764099121,
      "learning_rate": 2.916675022706239e-07,
      "loss": 0.178,
      "mae_dtheta": 0.011423519812524319,
      "mae_dx": 0.0013519464991986752,
      "mae_dy": 0.0021843216381967068,
      "pose_mae_dtheta": 0.07261624187231064,
      "pose_mae_dx": 0.01616547629237175,
      "pose_mae_dy": 0.02513747476041317,
      "pose_rmse_dtheta": 0.1895502358675003,
      "pose_rmse_dx": 0.03957750275731087,
      "pose_rmse_dy": 0.06685268878936768,
      "pose_rmse_mean": 0.09866014122962952,
      "rmse_dtheta": 0.025770140811800957,
      "rmse_dx": 0.004155091941356659,
      "rmse_dy": 0.0058747343719005585,
      "rmse_mean": 0.011933322064578533,
      "rotation_flip": 0.00855365488678217,
      "sparse_tokens": 32121.0,
      "step": 10703,
      "turn_loss": 0.09183800965547562,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12350.0,
      "epoch": 0.4973053335811187,
      "grad_norm": 0.49061858654022217,
      "learning_rate": 2.9122267739283726e-07,
      "loss": 0.1242,
      "mae_dtheta": 0.03581656515598297,
      "mae_dx": 0.010804328136146069,
      "mae_dy": 0.005962027236819267,
      "pose_mae_dtheta": 0.27314913272857666,
      "pose_mae_dx": 0.08858185261487961,
      "pose_mae_dy": 0.07244599610567093,
      "pose_rmse_dtheta": 0.4771416187286377,
      "pose_rmse_dx": 0.1924552321434021,
      "pose_rmse_dy": 0.16465900838375092,
      "pose_rmse_mean": 0.27808529138565063,
      "rmse_dtheta": 0.053622063249349594,
      "rmse_dx": 0.023445649072527885,
      "rmse_dy": 0.012605009600520134,
      "rmse_mean": 0.029890907928347588,
      "rotation_flip": 0.014263074845075607,
      "sparse_tokens": 10104.0,
      "step": 10704,
      "turn_loss": 0.2593517303466797,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.49735179334696156,
      "grad_norm": 0.5969367027282715,
      "learning_rate": 2.9077818180237693e-07,
      "loss": 0.0968,
      "mae_dtheta": 0.025675682350993156,
      "mae_dx": 0.010968372225761414,
      "mae_dy": 0.004170177038758993,
      "pose_mae_dtheta": 0.18921317160129547,
      "pose_mae_dx": 0.08466450870037079,
      "pose_mae_dy": 0.06015796586871147,
      "pose_rmse_dtheta": 0.3701525032520294,
      "pose_rmse_dx": 0.19517479836940765,
      "pose_rmse_dy": 0.14728328585624695,
      "pose_rmse_mean": 0.23753687739372253,
      "rmse_dtheta": 0.041889045387506485,
      "rmse_dx": 0.02350754849612713,
      "rmse_dy": 0.008304703049361706,
      "rmse_mean": 0.024567097425460815,
      "rotation_flip": 0.015817223116755486,
      "sparse_tokens": 11421.0,
      "step": 10705,
      "turn_loss": 0.25206804275512695,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.49739825311280433,
      "grad_norm": 0.3673591911792755,
      "learning_rate": 2.9033401553032525e-07,
      "loss": 0.0806,
      "mae_dtheta": 0.007602694910019636,
      "mae_dx": 0.0013737150002270937,
      "mae_dy": 0.0016360364388674498,
      "pose_mae_dtheta": 0.052052028477191925,
      "pose_mae_dx": 0.016663141548633575,
      "pose_mae_dy": 0.0202422346919775,
      "pose_rmse_dtheta": 0.1418207436800003,
      "pose_rmse_dx": 0.04533788561820984,
      "pose_rmse_dy": 0.04983372986316681,
      "pose_rmse_mean": 0.07899745553731918,
      "rmse_dtheta": 0.018278008326888084,
      "rmse_dx": 0.004341925960034132,
      "rmse_dy": 0.003937360364943743,
      "rmse_mean": 0.008852431550621986,
      "rotation_flip": 0.006787330377846956,
      "sparse_tokens": 32089.0,
      "step": 10706,
      "turn_loss": 0.06073255091905594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.4974447128786471,
      "grad_norm": 1.2595864534378052,
      "learning_rate": 2.898901786077446e-07,
      "loss": 0.2725,
      "mae_dtheta": 0.043466903269290924,
      "mae_dx": 0.016230925917625427,
      "mae_dy": 0.004565875045955181,
      "pose_mae_dtheta": 0.39443090558052063,
      "pose_mae_dx": 0.10531260073184967,
      "pose_mae_dy": 0.06755723804235458,
      "pose_rmse_dtheta": 0.6650278568267822,
      "pose_rmse_dx": 0.23262611031532288,
      "pose_rmse_dy": 0.18777821958065033,
      "pose_rmse_mean": 0.36181074380874634,
      "rmse_dtheta": 0.06284424662590027,
      "rmse_dx": 0.029386308044195175,
      "rmse_dy": 0.011236943304538727,
      "rmse_mean": 0.03448916971683502,
      "rotation_flip": 0.0064239827916026115,
      "sparse_tokens": 7499.0,
      "step": 10707,
      "turn_loss": 0.31568199396133423,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 37963.0,
      "epoch": 0.4974911726444899,
      "grad_norm": 0.5654141902923584,
      "learning_rate": 2.894466710656707e-07,
      "loss": 0.1892,
      "mae_dtheta": 0.040182244032621384,
      "mae_dx": 0.013595089316368103,
      "mae_dy": 0.0057003735564649105,
      "pose_mae_dtheta": 0.3180992901325226,
      "pose_mae_dx": 0.11246547847986221,
      "pose_mae_dy": 0.06342212855815887,
      "pose_rmse_dtheta": 0.5597499012947083,
      "pose_rmse_dx": 0.23538251221179962,
      "pose_rmse_dy": 0.15135717391967773,
      "pose_rmse_mean": 0.3154965341091156,
      "rmse_dtheta": 0.0595259889960289,
      "rmse_dx": 0.025894688442349434,
      "rmse_dy": 0.013161270879209042,
      "rmse_mean": 0.0328606516122818,
      "rotation_flip": 0.014323607087135315,
      "sparse_tokens": 29566.0,
      "step": 10708,
      "turn_loss": 0.3444920778274536,
      "turns": 117.0,
      "turns_per_sample": 117.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.49753763241033266,
      "grad_norm": 0.5505474209785461,
      "learning_rate": 2.8900349293511984e-07,
      "loss": 0.1557,
      "mae_dtheta": 0.0064459932036697865,
      "mae_dx": 0.0016399931628257036,
      "mae_dy": 0.0023098925594240427,
      "pose_mae_dtheta": 0.045210838317871094,
      "pose_mae_dx": 0.019422244280576706,
      "pose_mae_dy": 0.018910648301243782,
      "pose_rmse_dtheta": 0.09850479662418365,
      "pose_rmse_dx": 0.058056775480508804,
      "pose_rmse_dy": 0.05256032943725586,
      "pose_rmse_mean": 0.06970730423927307,
      "rmse_dtheta": 0.014704816974699497,
      "rmse_dx": 0.004272584803402424,
      "rmse_dy": 0.0059079681523144245,
      "rmse_mean": 0.008295123465359211,
      "rotation_flip": 0.0028782894369214773,
      "sparse_tokens": 32169.0,
      "step": 10709,
      "turn_loss": 0.058501195162534714,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 39466.0,
      "epoch": 0.49758409217617544,
      "grad_norm": 0.4865790903568268,
      "learning_rate": 2.8856064424708395e-07,
      "loss": 0.1478,
      "mae_dtheta": 0.03351588174700737,
      "mae_dx": 0.011998172849416733,
      "mae_dy": 0.006765074096620083,
      "pose_mae_dtheta": 0.26656824350357056,
      "pose_mae_dx": 0.10036828368902206,
      "pose_mae_dy": 0.08262386173009872,
      "pose_rmse_dtheta": 0.47049927711486816,
      "pose_rmse_dx": 0.23381829261779785,
      "pose_rmse_dy": 0.1962181031703949,
      "pose_rmse_mean": 0.300178587436676,
      "rmse_dtheta": 0.05094560980796814,
      "rmse_dx": 0.024804478511214256,
      "rmse_dy": 0.014464990235865116,
      "rmse_mean": 0.030071694403886795,
      "rotation_flip": 0.006670372560620308,
      "sparse_tokens": 29866.0,
      "step": 10710,
      "turn_loss": 0.2691461145877838,
      "turns": 122.0,
      "turns_per_sample": 122.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4976305519420182,
      "grad_norm": 0.3096534013748169,
      "learning_rate": 2.881181250325299e-07,
      "loss": 0.0905,
      "mae_dtheta": 0.006866335403174162,
      "mae_dx": 0.0009962342446669936,
      "mae_dy": 0.0015426580794155598,
      "pose_mae_dtheta": 0.04641164466738701,
      "pose_mae_dx": 0.012443133629858494,
      "pose_mae_dy": 0.020556826144456863,
      "pose_rmse_dtheta": 0.13189993798732758,
      "pose_rmse_dx": 0.029253782704472542,
      "pose_rmse_dy": 0.04861214756965637,
      "pose_rmse_mean": 0.06992195546627045,
      "rmse_dtheta": 0.01593771204352379,
      "rmse_dx": 0.0031279269605875015,
      "rmse_dy": 0.003467956557869911,
      "rmse_mean": 0.0075111985206604,
      "rotation_flip": 0.002436053706333041,
      "sparse_tokens": 32073.0,
      "step": 10711,
      "turn_loss": 0.05710267648100853,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21680.0,
      "epoch": 0.497677011707861,
      "grad_norm": 0.5545071959495544,
      "learning_rate": 2.876759353224057e-07,
      "loss": 0.1082,
      "mae_dtheta": 0.03176162391901016,
      "mae_dx": 0.011861150152981281,
      "mae_dy": 0.003670074976980686,
      "pose_mae_dtheta": 0.2634679675102234,
      "pose_mae_dx": 0.10420489311218262,
      "pose_mae_dy": 0.05898989737033844,
      "pose_rmse_dtheta": 0.47825777530670166,
      "pose_rmse_dx": 0.2527119815349579,
      "pose_rmse_dy": 0.13011011481285095,
      "pose_rmse_mean": 0.28702664375305176,
      "rmse_dtheta": 0.050211966037750244,
      "rmse_dx": 0.025755109265446663,
      "rmse_dy": 0.006330553442239761,
      "rmse_mean": 0.02743254229426384,
      "rotation_flip": 0.010593220591545105,
      "sparse_tokens": 17154.0,
      "step": 10712,
      "turn_loss": 0.21336208283901215,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.49772347147370377,
      "grad_norm": 0.38451769948005676,
      "learning_rate": 2.8723407514763104e-07,
      "loss": 0.0798,
      "mae_dtheta": 0.008529026992619038,
      "mae_dx": 0.0016817898722365499,
      "mae_dy": 0.0018969002412632108,
      "pose_mae_dtheta": 0.061175648123025894,
      "pose_mae_dx": 0.018268253654241562,
      "pose_mae_dy": 0.022333892062306404,
      "pose_rmse_dtheta": 0.1705314964056015,
      "pose_rmse_dx": 0.05012606084346771,
      "pose_rmse_dy": 0.04961845651268959,
      "pose_rmse_mean": 0.0900920033454895,
      "rmse_dtheta": 0.0198979489505291,
      "rmse_dx": 0.005645310506224632,
      "rmse_dy": 0.005156093742698431,
      "rmse_mean": 0.010233118198812008,
      "rotation_flip": 0.0038893690798431635,
      "sparse_tokens": 32105.0,
      "step": 10713,
      "turn_loss": 0.07970517873764038,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.49776993123954655,
      "grad_norm": 0.5244032144546509,
      "learning_rate": 2.867925445391079e-07,
      "loss": 0.107,
      "mae_dtheta": 0.017300138249993324,
      "mae_dx": 0.005246935877948999,
      "mae_dy": 0.003513918723911047,
      "pose_mae_dtheta": 0.1368909478187561,
      "pose_mae_dx": 0.035525258630514145,
      "pose_mae_dy": 0.05209353566169739,
      "pose_rmse_dtheta": 0.2947043180465698,
      "pose_rmse_dx": 0.08974902331829071,
      "pose_rmse_dy": 0.16064007580280304,
      "pose_rmse_mean": 0.181697815656662,
      "rmse_dtheta": 0.032053202390670776,
      "rmse_dx": 0.014680353924632072,
      "rmse_dy": 0.008011524565517902,
      "rmse_mean": 0.018248360604047775,
      "rotation_flip": 0.012285011820495129,
      "sparse_tokens": 8749.0,
      "step": 10714,
      "turn_loss": 0.1456969976425171,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4978163910053893,
      "grad_norm": 0.42952531576156616,
      "learning_rate": 2.863513435277121e-07,
      "loss": 0.0834,
      "mae_dtheta": 0.009553167968988419,
      "mae_dx": 0.0016035849694162607,
      "mae_dy": 0.0025254306383430958,
      "pose_mae_dtheta": 0.0661267414689064,
      "pose_mae_dx": 0.022329356521368027,
      "pose_mae_dy": 0.02646002732217312,
      "pose_rmse_dtheta": 0.16984069347381592,
      "pose_rmse_dx": 0.06777861714363098,
      "pose_rmse_dy": 0.06315483152866364,
      "pose_rmse_mean": 0.10025805234909058,
      "rmse_dtheta": 0.02071620710194111,
      "rmse_dx": 0.004825918935239315,
      "rmse_dy": 0.006020848173648119,
      "rmse_mean": 0.010520990937948227,
      "rotation_flip": 0.004556752275675535,
      "sparse_tokens": 32089.0,
      "step": 10715,
      "turn_loss": 0.07866713404655457,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.4978628507712321,
      "grad_norm": 0.3037428557872772,
      "learning_rate": 2.8591047214429626e-07,
      "loss": 0.0761,
      "mae_dtheta": 0.009764584712684155,
      "mae_dx": 0.001054662629030645,
      "mae_dy": 0.0016703696455806494,
      "pose_mae_dtheta": 0.06120496243238449,
      "pose_mae_dx": 0.011739939451217651,
      "pose_mae_dy": 0.017742397263646126,
      "pose_rmse_dtheta": 0.1828654408454895,
      "pose_rmse_dx": 0.02532944455742836,
      "pose_rmse_dy": 0.0362577885389328,
      "pose_rmse_mean": 0.08148422837257385,
      "rmse_dtheta": 0.023336386308073997,
      "rmse_dx": 0.0032797805033624172,
      "rmse_dy": 0.0033454771619290113,
      "rmse_mean": 0.00998721458017826,
      "rotation_flip": 0.001854599453508854,
      "sparse_tokens": 32121.0,
      "step": 10716,
      "turn_loss": 0.06434706598520279,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4979093105370749,
      "grad_norm": 0.3616868257522583,
      "learning_rate": 2.8546993041969173e-07,
      "loss": 0.0717,
      "mae_dtheta": 0.00720962742343545,
      "mae_dx": 0.0016914606094360352,
      "mae_dy": 0.002207182114943862,
      "pose_mae_dtheta": 0.042763035744428635,
      "pose_mae_dx": 0.020734842866659164,
      "pose_mae_dy": 0.018915634602308273,
      "pose_rmse_dtheta": 0.10225100070238113,
      "pose_rmse_dx": 0.05828939750790596,
      "pose_rmse_dy": 0.044268976897001266,
      "pose_rmse_mean": 0.06826979666948318,
      "rmse_dtheta": 0.017168667167425156,
      "rmse_dx": 0.004399700555950403,
      "rmse_dy": 0.005698869936168194,
      "rmse_mean": 0.00908907875418663,
      "rotation_flip": 0.003356956411153078,
      "sparse_tokens": 32153.0,
      "step": 10717,
      "turn_loss": 0.07122517377138138,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.49795577030291766,
      "grad_norm": 0.43896469473838806,
      "learning_rate": 2.8502971838470504e-07,
      "loss": 0.0915,
      "mae_dtheta": 0.03688739612698555,
      "mae_dx": 0.007282394915819168,
      "mae_dy": 0.005550943315029144,
      "pose_mae_dtheta": 0.2490772157907486,
      "pose_mae_dx": 0.05631571635603905,
      "pose_mae_dy": 0.05649642273783684,
      "pose_rmse_dtheta": 0.424074649810791,
      "pose_rmse_dx": 0.11614641547203064,
      "pose_rmse_dy": 0.11867764592170715,
      "pose_rmse_mean": 0.21963290870189667,
      "rmse_dtheta": 0.05134718492627144,
      "rmse_dx": 0.0160725936293602,
      "rmse_dy": 0.00978126097470522,
      "rmse_mean": 0.02573368325829506,
      "rotation_flip": 0.011574073694646358,
      "sparse_tokens": 6192.0,
      "step": 10718,
      "turn_loss": 0.22445759177207947,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.49800223006876043,
      "grad_norm": 0.5544277429580688,
      "learning_rate": 2.845898360701216e-07,
      "loss": 0.0981,
      "mae_dtheta": 0.030442560091614723,
      "mae_dx": 0.010539785027503967,
      "mae_dy": 0.005724033340811729,
      "pose_mae_dtheta": 0.21137429773807526,
      "pose_mae_dx": 0.07554654777050018,
      "pose_mae_dy": 0.05736386403441429,
      "pose_rmse_dtheta": 0.3952674865722656,
      "pose_rmse_dx": 0.15788516402244568,
      "pose_rmse_dy": 0.13806235790252686,
      "pose_rmse_mean": 0.2304050177335739,
      "rmse_dtheta": 0.04870115593075752,
      "rmse_dx": 0.02122352458536625,
      "rmse_dy": 0.012872209772467613,
      "rmse_mean": 0.027598965913057327,
      "rotation_flip": 0.014319809153676033,
      "sparse_tokens": 14058.0,
      "step": 10719,
      "turn_loss": 0.29638779163360596,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.4980486898346032,
      "grad_norm": 0.43889355659484863,
      "learning_rate": 2.841502835067006e-07,
      "loss": 0.1193,
      "mae_dtheta": 0.008477184921503067,
      "mae_dx": 0.0024940394796431065,
      "mae_dy": 0.0028047729283571243,
      "pose_mae_dtheta": 0.062120527029037476,
      "pose_mae_dx": 0.023423591628670692,
      "pose_mae_dy": 0.021820932626724243,
      "pose_rmse_dtheta": 0.17378385365009308,
      "pose_rmse_dx": 0.09620220959186554,
      "pose_rmse_dy": 0.056933123618364334,
      "pose_rmse_mean": 0.10897307097911835,
      "rmse_dtheta": 0.022395413368940353,
      "rmse_dx": 0.008776271715760231,
      "rmse_dy": 0.008642688393592834,
      "rmse_mean": 0.013271458446979523,
      "rotation_flip": 0.012094823643565178,
      "sparse_tokens": 32073.0,
      "step": 10720,
      "turn_loss": 0.10537498444318771,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.49809514960044604,
      "grad_norm": 0.5573154091835022,
      "learning_rate": 2.8371106072518194e-07,
      "loss": 0.1165,
      "mae_dtheta": 0.037852540612220764,
      "mae_dx": 0.0124368229880929,
      "mae_dy": 0.004860291723161936,
      "pose_mae_dtheta": 0.3075666129589081,
      "pose_mae_dx": 0.0886206328868866,
      "pose_mae_dy": 0.06724176555871964,
      "pose_rmse_dtheta": 0.48846691846847534,
      "pose_rmse_dx": 0.19092433154582977,
      "pose_rmse_dy": 0.15137523412704468,
      "pose_rmse_mean": 0.27692216634750366,
      "rmse_dtheta": 0.05442013218998909,
      "rmse_dx": 0.024407071992754936,
      "rmse_dy": 0.009217020124197006,
      "rmse_mean": 0.02934807538986206,
      "rotation_flip": 0.010515247471630573,
      "sparse_tokens": 13877.0,
      "step": 10721,
      "turn_loss": 0.2406456470489502,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 32662.0,
      "epoch": 0.4981416093662888,
      "grad_norm": 0.47367560863494873,
      "learning_rate": 2.832721677562805e-07,
      "loss": 0.1534,
      "mae_dtheta": 0.041214462369680405,
      "mae_dx": 0.012361306697130203,
      "mae_dy": 0.00881925504654646,
      "pose_mae_dtheta": 0.3082951605319977,
      "pose_mae_dx": 0.10254251211881638,
      "pose_mae_dy": 0.09655867516994476,
      "pose_rmse_dtheta": 0.5108435750007629,
      "pose_rmse_dx": 0.22406414151191711,
      "pose_rmse_dy": 0.252562940120697,
      "pose_rmse_mean": 0.32915690541267395,
      "rmse_dtheta": 0.05826771631836891,
      "rmse_dx": 0.024578232318162918,
      "rmse_dy": 0.020516902208328247,
      "rmse_mean": 0.034454286098480225,
      "rotation_flip": 0.016993464902043343,
      "sparse_tokens": 24508.0,
      "step": 10722,
      "turn_loss": 0.34034720063209534,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4981880691321316,
      "grad_norm": 0.39973020553588867,
      "learning_rate": 2.8283360463068786e-07,
      "loss": 0.0826,
      "mae_dtheta": 0.007176578510552645,
      "mae_dx": 0.0008074368815869093,
      "mae_dy": 0.0013275918317958713,
      "pose_mae_dtheta": 0.04939483478665352,
      "pose_mae_dx": 0.012558246031403542,
      "pose_mae_dy": 0.018573055043816566,
      "pose_rmse_dtheta": 0.1505458503961563,
      "pose_rmse_dx": 0.03922733664512634,
      "pose_rmse_dy": 0.04659945145249367,
      "pose_rmse_mean": 0.07879088073968887,
      "rmse_dtheta": 0.017938150092959404,
      "rmse_dx": 0.0028808889910578728,
      "rmse_dy": 0.0027798323426395655,
      "rmse_mean": 0.007866290397942066,
      "rotation_flip": 0.0038554216735064983,
      "sparse_tokens": 32041.0,
      "step": 10723,
      "turn_loss": 0.05104982852935791,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.49823452889797437,
      "grad_norm": 0.4302443563938141,
      "learning_rate": 2.823953713790734e-07,
      "loss": 0.1339,
      "mae_dtheta": 0.044297635555267334,
      "mae_dx": 0.006286922376602888,
      "mae_dy": 0.002729717642068863,
      "pose_mae_dtheta": 0.3546053171157837,
      "pose_mae_dx": 0.05046772584319115,
      "pose_mae_dy": 0.026378925889730453,
      "pose_rmse_dtheta": 0.6215919852256775,
      "pose_rmse_dx": 0.10851731896400452,
      "pose_rmse_dy": 0.07767331600189209,
      "pose_rmse_mean": 0.26926088333129883,
      "rmse_dtheta": 0.06490521878004074,
      "rmse_dx": 0.014488677494227886,
      "rmse_dy": 0.006977491080760956,
      "rmse_mean": 0.028790462762117386,
      "rotation_flip": 0.009027778171002865,
      "sparse_tokens": 21323.0,
      "step": 10724,
      "turn_loss": 0.26004287600517273,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.49828098866381715,
      "grad_norm": 0.6430193185806274,
      "learning_rate": 2.819574680320825e-07,
      "loss": 0.0902,
      "mae_dtheta": 0.00822869036346674,
      "mae_dx": 0.0013579860096797347,
      "mae_dy": 0.00023215310648083687,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6430191397666931,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 166.80477905273438,
      "model/head/act_norm_mean": 132.29799952651516,
      "model/head/act_norm_min": 86.3953628540039,
      "model/head/act_over_embed": 90.91642386800714,
      "model/head/grad_frac": 0.07451941817998886,
      "model/head/grad_norm": 0.04791741445660591,
      "model/head/grad_zero_frac": 0.00017735491564963013,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6920326309974747,
      "model/head/update_ratio": 0.0008157058618962765,
      "model/head/weight_delta": 9.97609806060791,
      "model/head/weight_delta_rel": 0.1750103086233139,
      "model/head/weight_norm": 58.74349594116211,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229133427143097,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228405891580785,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227621555328369,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905800115653975,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10570872575044632,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06797273457050323,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5531831781914893,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002194794826209545,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1547489166259766,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10307548195123672,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969970703125,
      "model/modality_embedder/grad_frac": 0.10570872575044632,
      "model/modality_embedder/grad_norm": 0.06797273457050323,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5531831781914893,
      "model/modality_embedder/update_ratio": 0.002194794826209545,
      "model/modality_embedder/weight_delta": 3.1547489166259766,
      "model/modality_embedder/weight_delta_rel": 0.10307548195123672,
      "model/modality_embedder/weight_norm": 30.969970703125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.19134521484375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.83759219175886,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.066330909729004,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.75583524952591,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.03783658891916275,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02432965114712715,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008701541228219867,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.737565517425537,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09975854307413101,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960163116455078,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.98197174072266,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.8887335658169,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.218978881835938,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.478189442719188,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.03651422634720802,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.023479346185922623,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007887197425588965,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.470701217651367,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12022780627012253,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76893424987793,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.82141876220703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.740134479717813,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.230032920837402,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.750489483840337,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.03397337719798088,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.021845532581210136,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000710642256308347,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7599780559539795,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12625302374362946,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.74054718017578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.49519348144531,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 30.327709135000802,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.014423370361328,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.841485650058903,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.028580941259860992,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.018378091976046562,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.000613541342318058,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.231595277786255,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11044058948755264,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954120635986328,
      "model/normalizer/grad_frac": 0.11122795939445496,
      "model/normalizer/grad_norm": 0.07152170687913895,
      "model/normalizer/grad_zero_frac": 0.00022453030396718532,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0009092980762943625,
      "model/normalizer/weight_delta": 6.796884059906006,
      "model/normalizer/weight_delta_rel": 0.08753993362188339,
      "model/normalizer/weight_norm": 78.65595245361328,
      "pose_mae_dtheta": 0.06006643548607826,
      "pose_mae_dx": 0.009861558675765991,
      "pose_mae_dy": 0.0024573602713644505,
      "pose_rmse_dtheta": 0.27523916959762573,
      "pose_rmse_dx": 0.0272377822548151,
      "pose_rmse_dy": 0.004859237466007471,
      "pose_rmse_mean": 0.10244539380073547,
      "rmse_dtheta": 0.03158915415406227,
      "rmse_dx": 0.0041045499965548515,
      "rmse_dy": 0.0006222119554877281,
      "rmse_mean": 0.01210530661046505,
      "rotation_flip": 0.001855287584476173,
      "sparse_tokens": 32201.0,
      "step": 10725,
      "turn_loss": 0.03821040689945221,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.4983274484296599,
      "grad_norm": 0.612687885761261,
      "learning_rate": 2.815198946203379e-07,
      "loss": 0.126,
      "mae_dtheta": 0.03183145821094513,
      "mae_dx": 0.011011692695319653,
      "mae_dy": 0.004686370026320219,
      "pose_mae_dtheta": 0.24884362518787384,
      "pose_mae_dx": 0.09676405042409897,
      "pose_mae_dy": 0.07081974297761917,
      "pose_rmse_dtheta": 0.4499913156032562,
      "pose_rmse_dx": 0.24025504291057587,
      "pose_rmse_dy": 0.12931950390338898,
      "pose_rmse_mean": 0.27318862080574036,
      "rmse_dtheta": 0.04817628115415573,
      "rmse_dx": 0.024228284135460854,
      "rmse_dy": 0.007327822037041187,
      "rmse_mean": 0.026577463373541832,
      "rotation_flip": 0.004991680383682251,
      "sparse_tokens": 10452.0,
      "step": 10726,
      "turn_loss": 0.2951803207397461,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4983739081955027,
      "grad_norm": 0.5476258397102356,
      "learning_rate": 2.8108265117444025e-07,
      "loss": 0.1097,
      "mae_dtheta": 0.006348373368382454,
      "mae_dx": 0.0010653591016307473,
      "mae_dy": 0.0015770380850881338,
      "pose_mae_dtheta": 0.03930310159921646,
      "pose_mae_dx": 0.013902361504733562,
      "pose_mae_dy": 0.01873614266514778,
      "pose_rmse_dtheta": 0.07284540683031082,
      "pose_rmse_dx": 0.029841119423508644,
      "pose_rmse_dy": 0.03972913324832916,
      "pose_rmse_mean": 0.04747188836336136,
      "rmse_dtheta": 0.012493916787207127,
      "rmse_dx": 0.0030743484385311604,
      "rmse_dy": 0.003152690827846527,
      "rmse_mean": 0.0062403189949691296,
      "rotation_flip": 0.0040997606702148914,
      "sparse_tokens": 32153.0,
      "step": 10727,
      "turn_loss": 0.054893724620342255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4984203679613455,
      "grad_norm": 0.6489817500114441,
      "learning_rate": 2.80645737724965e-07,
      "loss": 0.107,
      "mae_dtheta": 0.0075864167883992195,
      "mae_dx": 0.001657099579460919,
      "mae_dy": 0.0013133359607309103,
      "pose_mae_dtheta": 0.054881107062101364,
      "pose_mae_dx": 0.014546766877174377,
      "pose_mae_dy": 0.01517617516219616,
      "pose_rmse_dtheta": 0.19956563413143158,
      "pose_rmse_dx": 0.03890392929315567,
      "pose_rmse_dy": 0.03672335669398308,
      "pose_rmse_mean": 0.09173097461462021,
      "rmse_dtheta": 0.021054312586784363,
      "rmse_dx": 0.00563623383641243,
      "rmse_dy": 0.0030140827875584364,
      "rmse_mean": 0.009901543147861958,
      "rotation_flip": 0.0064629847183823586,
      "sparse_tokens": 32089.0,
      "step": 10728,
      "turn_loss": 0.0601760633289814,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.49846682772718826,
      "grad_norm": 0.5068948268890381,
      "learning_rate": 2.802091543024671e-07,
      "loss": 0.1102,
      "mae_dtheta": 0.01181522011756897,
      "mae_dx": 0.001225450076162815,
      "mae_dy": 0.002326004207134247,
      "pose_mae_dtheta": 0.0763893723487854,
      "pose_mae_dx": 0.021036401391029358,
      "pose_mae_dy": 0.031156452372670174,
      "pose_rmse_dtheta": 0.1936102956533432,
      "pose_rmse_dx": 0.050686996430158615,
      "pose_rmse_dy": 0.06862615048885345,
      "pose_rmse_mean": 0.10430781543254852,
      "rmse_dtheta": 0.024575555697083473,
      "rmse_dx": 0.0034102334175258875,
      "rmse_dy": 0.004568539094179869,
      "rmse_mean": 0.010851442813873291,
      "rotation_flip": 0.003322259057313204,
      "sparse_tokens": 32073.0,
      "step": 10729,
      "turn_loss": 0.08059978485107422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.49851328749303103,
      "grad_norm": 0.7138708829879761,
      "learning_rate": 2.79772900937475e-07,
      "loss": 0.1829,
      "mae_dtheta": 0.03968191519379616,
      "mae_dx": 0.015098702162504196,
      "mae_dy": 0.008497309871017933,
      "pose_mae_dtheta": 0.3116568624973297,
      "pose_mae_dx": 0.12532471120357513,
      "pose_mae_dy": 0.10720760375261307,
      "pose_rmse_dtheta": 0.5206815600395203,
      "pose_rmse_dx": 0.2542335093021393,
      "pose_rmse_dy": 0.2311469316482544,
      "pose_rmse_mean": 0.3353540301322937,
      "rmse_dtheta": 0.056509360671043396,
      "rmse_dx": 0.027008429169654846,
      "rmse_dy": 0.016358835622668266,
      "rmse_mean": 0.03329221159219742,
      "rotation_flip": 0.015209125354886055,
      "sparse_tokens": 22476.0,
      "step": 10730,
      "turn_loss": 0.32389822602272034,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.4985597472588738,
      "grad_norm": 0.5205211639404297,
      "learning_rate": 2.793369776604987e-07,
      "loss": 0.1036,
      "mae_dtheta": 0.008822335861623287,
      "mae_dx": 0.0015426699537783861,
      "mae_dy": 0.002238724147900939,
      "pose_mae_dtheta": 0.05514359474182129,
      "pose_mae_dx": 0.020160777494311333,
      "pose_mae_dy": 0.02494926191866398,
      "pose_rmse_dtheta": 0.11850392818450928,
      "pose_rmse_dx": 0.04930882900953293,
      "pose_rmse_dy": 0.05529646575450897,
      "pose_rmse_mean": 0.07436974346637726,
      "rmse_dtheta": 0.01877792924642563,
      "rmse_dx": 0.0042602429166436195,
      "rmse_dy": 0.005110134370625019,
      "rmse_mean": 0.009382768534123898,
      "rotation_flip": 0.005343197844922543,
      "sparse_tokens": 32089.0,
      "step": 10731,
      "turn_loss": 0.07566044479608536,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.4986062070247166,
      "grad_norm": 0.6835217475891113,
      "learning_rate": 2.7890138450202053e-07,
      "loss": 0.1679,
      "mae_dtheta": 0.041185177862644196,
      "mae_dx": 0.010570819489657879,
      "mae_dy": 0.0042648217640817165,
      "pose_mae_dtheta": 0.3344820737838745,
      "pose_mae_dx": 0.08693012595176697,
      "pose_mae_dy": 0.04954684153199196,
      "pose_rmse_dtheta": 0.5699417591094971,
      "pose_rmse_dx": 0.20386932790279388,
      "pose_rmse_dy": 0.13925500214099884,
      "pose_rmse_mean": 0.3043553829193115,
      "rmse_dtheta": 0.060964107513427734,
      "rmse_dx": 0.023766357451677322,
      "rmse_dy": 0.008582212962210178,
      "rmse_mean": 0.031104225665330887,
      "rotation_flip": 0.018949180841445923,
      "sparse_tokens": 18980.0,
      "step": 10732,
      "turn_loss": 0.2572840750217438,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.49865266679055936,
      "grad_norm": 0.49763500690460205,
      "learning_rate": 2.7846612149250274e-07,
      "loss": 0.1193,
      "mae_dtheta": 0.009815428406000137,
      "mae_dx": 0.0031744353473186493,
      "mae_dy": 0.0026793046854436398,
      "pose_mae_dtheta": 0.07066972553730011,
      "pose_mae_dx": 0.031821511685848236,
      "pose_mae_dy": 0.022754177451133728,
      "pose_rmse_dtheta": 0.17223963141441345,
      "pose_rmse_dx": 0.09190291911363602,
      "pose_rmse_dy": 0.0667150691151619,
      "pose_rmse_mean": 0.11028587073087692,
      "rmse_dtheta": 0.021520255133509636,
      "rmse_dx": 0.009605588391423225,
      "rmse_dy": 0.0064686136320233345,
      "rmse_mean": 0.01253148540854454,
      "rotation_flip": 0.003911342937499285,
      "sparse_tokens": 32249.0,
      "step": 10733,
      "turn_loss": 0.11397872120141983,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.49869912655640214,
      "grad_norm": 0.37162789702415466,
      "learning_rate": 2.7803118866238324e-07,
      "loss": 0.0989,
      "mae_dtheta": 0.006958735641092062,
      "mae_dx": 0.0014530901098623872,
      "mae_dy": 0.0015234308084473014,
      "pose_mae_dtheta": 0.0461425855755806,
      "pose_mae_dx": 0.016780732199549675,
      "pose_mae_dy": 0.01604306511580944,
      "pose_rmse_dtheta": 0.15247395634651184,
      "pose_rmse_dx": 0.05651576444506645,
      "pose_rmse_dy": 0.03961948677897453,
      "pose_rmse_mean": 0.08286973834037781,
      "rmse_dtheta": 0.019096214324235916,
      "rmse_dx": 0.005568112246692181,
      "rmse_dy": 0.00484659057110548,
      "rmse_mean": 0.009836973622441292,
      "rotation_flip": 0.004746084567159414,
      "sparse_tokens": 32105.0,
      "step": 10734,
      "turn_loss": 0.060203518718481064,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.4987455863222449,
      "grad_norm": 0.3364240527153015,
      "learning_rate": 2.7759658604207705e-07,
      "loss": 0.0954,
      "mae_dtheta": 0.007753764279186726,
      "mae_dx": 0.0012153618736192584,
      "mae_dy": 0.00113141059409827,
      "pose_mae_dtheta": 0.051615938544273376,
      "pose_mae_dx": 0.012352252379059792,
      "pose_mae_dy": 0.015528683550655842,
      "pose_rmse_dtheta": 0.18932762742042542,
      "pose_rmse_dx": 0.02778552658855915,
      "pose_rmse_dy": 0.03934871405363083,
      "pose_rmse_mean": 0.08548729121685028,
      "rmse_dtheta": 0.021954217925667763,
      "rmse_dx": 0.003606807440519333,
      "rmse_dy": 0.0026496234349906445,
      "rmse_mean": 0.009403550066053867,
      "rotation_flip": 0.004824561532586813,
      "sparse_tokens": 32153.0,
      "step": 10735,
      "turn_loss": 0.051696162670850754,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.4987920460880877,
      "grad_norm": 0.5544484853744507,
      "learning_rate": 2.7716231366197663e-07,
      "loss": 0.1478,
      "mae_dtheta": 0.03255945071578026,
      "mae_dx": 0.006453513167798519,
      "mae_dy": 0.0030237301252782345,
      "pose_mae_dtheta": 0.25282832980155945,
      "pose_mae_dx": 0.05318601429462433,
      "pose_mae_dy": 0.03086523339152336,
      "pose_rmse_dtheta": 0.48889151215553284,
      "pose_rmse_dx": 0.1079089418053627,
      "pose_rmse_dy": 0.06228362023830414,
      "pose_rmse_mean": 0.21969470381736755,
      "rmse_dtheta": 0.05200323835015297,
      "rmse_dx": 0.014151378534734249,
      "rmse_dy": 0.005251050461083651,
      "rmse_mean": 0.023801889270544052,
      "rotation_flip": 0.011267605237662792,
      "sparse_tokens": 6282.0,
      "step": 10736,
      "turn_loss": 0.2022257298231125,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.49883850585393047,
      "grad_norm": 0.3505690395832062,
      "learning_rate": 2.767283715524505e-07,
      "loss": 0.0737,
      "mae_dtheta": 0.00898454338312149,
      "mae_dx": 0.0015720261726528406,
      "mae_dy": 0.0023135512601584196,
      "pose_mae_dtheta": 0.06313619017601013,
      "pose_mae_dx": 0.019939664751291275,
      "pose_mae_dy": 0.024076180532574654,
      "pose_rmse_dtheta": 0.1490471512079239,
      "pose_rmse_dx": 0.05128125473856926,
      "pose_rmse_dy": 0.05332830920815468,
      "pose_rmse_mean": 0.08455224335193634,
      "rmse_dtheta": 0.019933829084038734,
      "rmse_dx": 0.004782368894666433,
      "rmse_dy": 0.005604830104857683,
      "rmse_mean": 0.010107009671628475,
      "rotation_flip": 0.004284490365535021,
      "sparse_tokens": 32089.0,
      "step": 10737,
      "turn_loss": 0.07882437855005264,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.4988849656197733,
      "grad_norm": 0.46100130677223206,
      "learning_rate": 2.762947597438442e-07,
      "loss": 0.0924,
      "mae_dtheta": 0.009912988170981407,
      "mae_dx": 0.0019911816343665123,
      "mae_dy": 0.0018862871220335364,
      "pose_mae_dtheta": 0.07130903005599976,
      "pose_mae_dx": 0.019403627142310143,
      "pose_mae_dy": 0.022354932501912117,
      "pose_rmse_dtheta": 0.19961033761501312,
      "pose_rmse_dx": 0.05451234057545662,
      "pose_rmse_dy": 0.05061740800738335,
      "pose_rmse_mean": 0.10158002376556396,
      "rmse_dtheta": 0.023704586550593376,
      "rmse_dx": 0.006757619325071573,
      "rmse_dy": 0.005024539772421122,
      "rmse_mean": 0.011828916147351265,
      "rotation_flip": 0.0042553190141916275,
      "sparse_tokens": 32105.0,
      "step": 10738,
      "turn_loss": 0.0779842957854271,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.4989314253856161,
      "grad_norm": 0.3313157260417938,
      "learning_rate": 2.758614782664809e-07,
      "loss": 0.0979,
      "mae_dtheta": 0.0346563495695591,
      "mae_dx": 0.012164199724793434,
      "mae_dy": 0.00389474187977612,
      "pose_mae_dtheta": 0.2810349464416504,
      "pose_mae_dx": 0.09759317338466644,
      "pose_mae_dy": 0.036508094519376755,
      "pose_rmse_dtheta": 0.4887245297431946,
      "pose_rmse_dx": 0.2298332154750824,
      "pose_rmse_dy": 0.09114472568035126,
      "pose_rmse_mean": 0.2699008285999298,
      "rmse_dtheta": 0.051875192672014236,
      "rmse_dx": 0.024834558367729187,
      "rmse_dy": 0.009643105790019035,
      "rmse_mean": 0.028784286230802536,
      "rotation_flip": 0.01145833358168602,
      "sparse_tokens": 14219.0,
      "step": 10739,
      "turn_loss": 0.27583593130111694,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.49897788515145886,
      "grad_norm": 0.42613813281059265,
      "learning_rate": 2.754285271506596e-07,
      "loss": 0.1098,
      "mae_dtheta": 0.011678403243422508,
      "mae_dx": 0.0018392051570117474,
      "mae_dy": 0.0024220948107540607,
      "pose_mae_dtheta": 0.07894095033407211,
      "pose_mae_dx": 0.023175524547696114,
      "pose_mae_dy": 0.026375528424978256,
      "pose_rmse_dtheta": 0.17948675155639648,
      "pose_rmse_dx": 0.05391557142138481,
      "pose_rmse_dy": 0.05930256098508835,
      "pose_rmse_mean": 0.09756829589605331,
      "rmse_dtheta": 0.02339712530374527,
      "rmse_dx": 0.005286151543259621,
      "rmse_dy": 0.004806786309927702,
      "rmse_mean": 0.01116335391998291,
      "rotation_flip": 0.0037917960435152054,
      "sparse_tokens": 32153.0,
      "step": 10740,
      "turn_loss": 0.0928281918168068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.49902434491730163,
      "grad_norm": 0.45181921124458313,
      "learning_rate": 2.7499590642665773e-07,
      "loss": 0.1255,
      "mae_dtheta": 0.010121607221662998,
      "mae_dx": 0.001959466375410557,
      "mae_dy": 0.003335049143061042,
      "pose_mae_dtheta": 0.05848276987671852,
      "pose_mae_dx": 0.021360840648412704,
      "pose_mae_dy": 0.025645684450864792,
      "pose_rmse_dtheta": 0.12063319236040115,
      "pose_rmse_dx": 0.0588582418859005,
      "pose_rmse_dy": 0.05403809994459152,
      "pose_rmse_mean": 0.07784318178892136,
      "rmse_dtheta": 0.020313527435064316,
      "rmse_dx": 0.005525271408259869,
      "rmse_dy": 0.0076580774039030075,
      "rmse_mean": 0.011165626347064972,
      "rotation_flip": 0.008789722807705402,
      "sparse_tokens": 32121.0,
      "step": 10741,
      "turn_loss": 0.10744526237249374,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 44002.0,
      "epoch": 0.4990708046831444,
      "grad_norm": 0.6571215987205505,
      "learning_rate": 2.745636161247278e-07,
      "loss": 0.1826,
      "mae_dtheta": 0.04603053629398346,
      "mae_dx": 0.013125896453857422,
      "mae_dy": 0.008252976462244987,
      "pose_mae_dtheta": 0.3776172399520874,
      "pose_mae_dx": 0.10817745327949524,
      "pose_mae_dy": 0.07836965471506119,
      "pose_rmse_dtheta": 0.6435775756835938,
      "pose_rmse_dx": 0.2265007197856903,
      "pose_rmse_dy": 0.20194609463214874,
      "pose_rmse_mean": 0.3573414981365204,
      "rmse_dtheta": 0.06677927076816559,
      "rmse_dx": 0.02556477300822735,
      "rmse_dy": 0.01874755136668682,
      "rmse_mean": 0.03703053295612335,
      "rotation_flip": 0.013966480270028114,
      "sparse_tokens": 30202.0,
      "step": 10742,
      "turn_loss": 0.36927124857902527,
      "turns": 136.0,
      "turns_per_sample": 136.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4991172644489872,
      "grad_norm": 0.4082127511501312,
      "learning_rate": 2.7413165627510117e-07,
      "loss": 0.0979,
      "mae_dtheta": 0.013901237398386002,
      "mae_dx": 0.0030164693016558886,
      "mae_dy": 0.005359310656785965,
      "pose_mae_dtheta": 0.09977804124355316,
      "pose_mae_dx": 0.045054201036691666,
      "pose_mae_dy": 0.05069343373179436,
      "pose_rmse_dtheta": 0.24586932361125946,
      "pose_rmse_dx": 0.11867042630910873,
      "pose_rmse_dy": 0.12602905929088593,
      "pose_rmse_mean": 0.16352294385433197,
      "rmse_dtheta": 0.027874764055013657,
      "rmse_dx": 0.00823058933019638,
      "rmse_dy": 0.014320256188511848,
      "rmse_mean": 0.016808537766337395,
      "rotation_flip": 0.011078286916017532,
      "sparse_tokens": 32041.0,
      "step": 10743,
      "turn_loss": 0.16037757694721222,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.49916372421482996,
      "grad_norm": 0.5809622406959534,
      "learning_rate": 2.737000269079837e-07,
      "loss": 0.1199,
      "mae_dtheta": 0.024957086890935898,
      "mae_dx": 0.006311353761702776,
      "mae_dy": 0.0036740326322615147,
      "pose_mae_dtheta": 0.1899700164794922,
      "pose_mae_dx": 0.04958382248878479,
      "pose_mae_dy": 0.04940830171108246,
      "pose_rmse_dtheta": 0.34469693899154663,
      "pose_rmse_dx": 0.1218765452504158,
      "pose_rmse_dy": 0.10740845650434494,
      "pose_rmse_mean": 0.1913273185491562,
      "rmse_dtheta": 0.041217781603336334,
      "rmse_dx": 0.016165001317858696,
      "rmse_dy": 0.00702312309294939,
      "rmse_mean": 0.021468637511134148,
      "rotation_flip": 0.004545454401522875,
      "sparse_tokens": 11374.0,
      "step": 10744,
      "turn_loss": 0.13585945963859558,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.49921018398067274,
      "grad_norm": 0.505703330039978,
      "learning_rate": 2.7326872805356065e-07,
      "loss": 0.0876,
      "mae_dtheta": 0.006254518870264292,
      "mae_dx": 0.001292059663683176,
      "mae_dy": 0.0009566599037498236,
      "pose_mae_dtheta": 0.045476000756025314,
      "pose_mae_dx": 0.01117401011288166,
      "pose_mae_dy": 0.011101017706096172,
      "pose_rmse_dtheta": 0.1673465520143509,
      "pose_rmse_dx": 0.037629760801792145,
      "pose_rmse_dy": 0.02749260887503624,
      "pose_rmse_mean": 0.07748964428901672,
      "rmse_dtheta": 0.020113075152039528,
      "rmse_dx": 0.004878535401076078,
      "rmse_dy": 0.002527309348806739,
      "rmse_mean": 0.009172974154353142,
      "rotation_flip": 0.002060439670458436,
      "sparse_tokens": 32073.0,
      "step": 10745,
      "turn_loss": 0.04782746359705925,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4992566437465155,
      "grad_norm": 0.7893536686897278,
      "learning_rate": 2.728377597419918e-07,
      "loss": 0.1359,
      "mae_dtheta": 0.00987927708774805,
      "mae_dx": 0.0018181443447247148,
      "mae_dy": 0.002025567926466465,
      "pose_mae_dtheta": 0.06787280738353729,
      "pose_mae_dx": 0.020816784352064133,
      "pose_mae_dy": 0.02610872872173786,
      "pose_rmse_dtheta": 0.18277627229690552,
      "pose_rmse_dx": 0.057202648371458054,
      "pose_rmse_dy": 0.06742136180400848,
      "pose_rmse_mean": 0.10246676206588745,
      "rmse_dtheta": 0.022894540801644325,
      "rmse_dx": 0.005979534704238176,
      "rmse_dy": 0.00442176079377532,
      "rmse_mean": 0.01109861209988594,
      "rotation_flip": 0.003086419776082039,
      "sparse_tokens": 32057.0,
      "step": 10746,
      "turn_loss": 0.08057884871959686,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.4993031035123583,
      "grad_norm": 0.6035158634185791,
      "learning_rate": 2.724071220034158e-07,
      "loss": 0.1741,
      "mae_dtheta": 0.036347854882478714,
      "mae_dx": 0.014572260901331902,
      "mae_dy": 0.0038321774918586016,
      "pose_mae_dtheta": 0.3284929096698761,
      "pose_mae_dx": 0.12083707749843597,
      "pose_mae_dy": 0.05350983515381813,
      "pose_rmse_dtheta": 0.5661784410476685,
      "pose_rmse_dx": 0.2499942183494568,
      "pose_rmse_dy": 0.12937113642692566,
      "pose_rmse_mean": 0.31518125534057617,
      "rmse_dtheta": 0.05531864985823631,
      "rmse_dx": 0.027416333556175232,
      "rmse_dy": 0.007344418205320835,
      "rmse_mean": 0.030026469379663467,
      "rotation_flip": 0.01161103043705225,
      "sparse_tokens": 12641.0,
      "step": 10747,
      "turn_loss": 0.3019252121448517,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.49934956327820107,
      "grad_norm": 0.5899651646614075,
      "learning_rate": 2.71976814867948e-07,
      "loss": 0.1477,
      "mae_dtheta": 0.04420241340994835,
      "mae_dx": 0.014323649927973747,
      "mae_dy": 0.006135022733360529,
      "pose_mae_dtheta": 0.36941689252853394,
      "pose_mae_dx": 0.11537842452526093,
      "pose_mae_dy": 0.06589458882808685,
      "pose_rmse_dtheta": 0.6001786589622498,
      "pose_rmse_dx": 0.2519988715648651,
      "pose_rmse_dy": 0.12927132844924927,
      "pose_rmse_mean": 0.3271496295928955,
      "rmse_dtheta": 0.06276241689920425,
      "rmse_dx": 0.027333999052643776,
      "rmse_dy": 0.010738897137343884,
      "rmse_mean": 0.03361177071928978,
      "rotation_flip": 0.008156606927514076,
      "sparse_tokens": 10510.0,
      "step": 10748,
      "turn_loss": 0.3126126229763031,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.49939602304404385,
      "grad_norm": 0.7291990518569946,
      "learning_rate": 2.715468383656783e-07,
      "loss": 0.1321,
      "mae_dtheta": 0.010421906597912312,
      "mae_dx": 0.0022642728872597218,
      "mae_dy": 0.00310342526063323,
      "pose_mae_dtheta": 0.07197994738817215,
      "pose_mae_dx": 0.03188150003552437,
      "pose_mae_dy": 0.029196815565228462,
      "pose_rmse_dtheta": 0.19342166185379028,
      "pose_rmse_dx": 0.09222452342510223,
      "pose_rmse_dy": 0.06355149298906326,
      "pose_rmse_mean": 0.11639922857284546,
      "rmse_dtheta": 0.0229711402207613,
      "rmse_dx": 0.00661690067499876,
      "rmse_dy": 0.007120524998754263,
      "rmse_mean": 0.012236188165843487,
      "rotation_flip": 0.0023132849019020796,
      "sparse_tokens": 32121.0,
      "step": 10749,
      "turn_loss": 0.09656240791082382,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36550.0,
      "epoch": 0.4994424828098866,
      "grad_norm": 0.5172176361083984,
      "learning_rate": 2.7111719252667644e-07,
      "loss": 0.1426,
      "mae_dtheta": 0.03404754400253296,
      "mae_dx": 0.009852828457951546,
      "mae_dy": 0.004821928683668375,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5172178745269775,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.43728637695312,
      "model/head/act_norm_mean": 104.46076465707965,
      "model/head/act_norm_min": 62.55176544189453,
      "model/head/act_over_embed": 71.78641544943214,
      "model/head/grad_frac": 0.1051897183060646,
      "model/head/grad_norm": 0.054406002163887024,
      "model/head/grad_zero_frac": 0.0001443586515961215,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6945865597345132,
      "model/head/update_ratio": 0.0009261606028303504,
      "model/head/weight_delta": 9.976733207702637,
      "model/head/weight_delta_rel": 0.1750214546918869,
      "model/head/weight_norm": 58.743595123291016,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228413999080658,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228413999080658,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228413999080658,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29058056872037913,
      "model/modality_embedder.encoders.pose/grad_frac": 0.0708848088979721,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03666289150714874,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011838212376460433,
      "model/modality_embedder.encoders.pose/weight_delta": 3.15488600730896,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10307995975017548,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969955444335938,
      "model/modality_embedder/grad_frac": 0.0708848088979721,
      "model/modality_embedder/grad_norm": 0.03666289150714874,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0011838212376460433,
      "model/modality_embedder/weight_delta": 3.15488600730896,
      "model/modality_embedder/weight_delta_rel": 0.10307995975017548,
      "model/modality_embedder/weight_norm": 30.969955444335938,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 79.67003631591797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.08116264573676,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.015137672424316,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.861591059399533,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06693247705698013,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.034618671983480453,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001238140044733882,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7378761768341064,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09976986050605774,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960224151611328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.1094970703125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.840027567074028,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.453335762023926,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.383090137947832,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06659215688705444,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.034442655742168427,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011569950729608536,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4710965156555176,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12024149298667908,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.769060134887695,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.09308624267578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.40412759867959,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.630559921264648,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.45795432300238,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06186441704630852,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03199738264083862,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001040880917571485,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.760422945022583,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1262679547071457,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.740676879882812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.98087310791016,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.255563895912346,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.771615028381348,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.730278679880435,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05003150925040245,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02587719075381756,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008638910949230194,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2319960594177246,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11045429110527039,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954227447509766,
      "model/normalizer/grad_frac": 0.19305634498596191,
      "model/normalizer/grad_norm": 0.09985218942165375,
      "model/normalizer/grad_zero_frac": 0.00018907814228441566,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0012694783508777618,
      "model/normalizer/weight_delta": 6.797677516937256,
      "model/normalizer/weight_delta_rel": 0.08755014836788177,
      "model/normalizer/weight_norm": 78.65608215332031,
      "pose_mae_dtheta": 0.27416348457336426,
      "pose_mae_dx": 0.0857066959142685,
      "pose_mae_dy": 0.055414680391550064,
      "pose_rmse_dtheta": 0.49801814556121826,
      "pose_rmse_dx": 0.19478639960289001,
      "pose_rmse_dy": 0.1366041600704193,
      "pose_rmse_mean": 0.2764695882797241,
      "rmse_dtheta": 0.05270051583647728,
      "rmse_dx": 0.021743377670645714,
      "rmse_dy": 0.009380502626299858,
      "rmse_mean": 0.027941465377807617,
      "rotation_flip": 0.01591981202363968,
      "sparse_tokens": 29082.0,
      "step": 10750,
      "turn_loss": 0.23266810178756714,
      "turns": 113.0,
      "turns_per_sample": 113.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.4994889425757294,
      "grad_norm": 0.5912570953369141,
      "learning_rate": 2.7068787738098735e-07,
      "loss": 0.1171,
      "mae_dtheta": 0.030370324850082397,
      "mae_dx": 0.012216177769005299,
      "mae_dy": 0.004687922541052103,
      "pose_mae_dtheta": 0.23512233793735504,
      "pose_mae_dx": 0.10249224305152893,
      "pose_mae_dy": 0.060343608260154724,
      "pose_rmse_dtheta": 0.44724592566490173,
      "pose_rmse_dx": 0.24352452158927917,
      "pose_rmse_dy": 0.12777209281921387,
      "pose_rmse_mean": 0.2728475332260132,
      "rmse_dtheta": 0.04623714089393616,
      "rmse_dx": 0.025774484500288963,
      "rmse_dy": 0.00934035424143076,
      "rmse_mean": 0.027117326855659485,
      "rotation_flip": 0.019512195140123367,
      "sparse_tokens": 11102.0,
      "step": 10751,
      "turn_loss": 0.2635504901409149,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 26526.0,
      "epoch": 0.4995354023415722,
      "grad_norm": 0.37662991881370544,
      "learning_rate": 2.702588929586331e-07,
      "loss": 0.0924,
      "mae_dtheta": 0.033307746052742004,
      "mae_dx": 0.015016975812613964,
      "mae_dy": 0.005591860041022301,
      "pose_mae_dtheta": 0.2500630021095276,
      "pose_mae_dx": 0.11645852774381638,
      "pose_mae_dy": 0.0707584097981453,
      "pose_rmse_dtheta": 0.45344704389572144,
      "pose_rmse_dx": 0.23478862643241882,
      "pose_rmse_dy": 0.14093847572803497,
      "pose_rmse_mean": 0.2763913869857788,
      "rmse_dtheta": 0.05126214027404785,
      "rmse_dx": 0.027277207002043724,
      "rmse_dy": 0.009860029444098473,
      "rmse_mean": 0.02946646139025688,
      "rotation_flip": 0.01159900613129139,
      "sparse_tokens": 21844.0,
      "step": 10752,
      "turn_loss": 0.26717984676361084,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.49958186210741495,
      "grad_norm": 0.5990774035453796,
      "learning_rate": 2.6983023928961406e-07,
      "loss": 0.0951,
      "mae_dtheta": 0.020230000838637352,
      "mae_dx": 0.003999521490186453,
      "mae_dy": 0.006094795651733875,
      "pose_mae_dtheta": 0.1369258612394333,
      "pose_mae_dx": 0.0462203249335289,
      "pose_mae_dy": 0.05249445512890816,
      "pose_rmse_dtheta": 0.21376736462116241,
      "pose_rmse_dx": 0.09624968469142914,
      "pose_rmse_dy": 0.08364074677228928,
      "pose_rmse_mean": 0.1312192678451538,
      "rmse_dtheta": 0.030440406873822212,
      "rmse_dx": 0.00963702891021967,
      "rmse_dy": 0.011257360689342022,
      "rmse_mean": 0.017111599445343018,
      "rotation_flip": 0.011627906933426857,
      "sparse_tokens": 4461.0,
      "step": 10753,
      "turn_loss": 0.18040134012699127,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 34391.0,
      "epoch": 0.4996283218732578,
      "grad_norm": 0.5869302153587341,
      "learning_rate": 2.694019164039041e-07,
      "loss": 0.1623,
      "mae_dtheta": 0.03023359179496765,
      "mae_dx": 0.009585662744939327,
      "mae_dy": 0.0030594957061111927,
      "pose_mae_dtheta": 0.24251484870910645,
      "pose_mae_dx": 0.07508791983127594,
      "pose_mae_dy": 0.030048925429582596,
      "pose_rmse_dtheta": 0.42304617166519165,
      "pose_rmse_dx": 0.16855815052986145,
      "pose_rmse_dy": 0.07478756457567215,
      "pose_rmse_mean": 0.2221306413412094,
      "rmse_dtheta": 0.047379471361637115,
      "rmse_dx": 0.02036089263856411,
      "rmse_dy": 0.0060446844436228275,
      "rmse_mean": 0.024595018476247787,
      "rotation_flip": 0.012680115178227425,
      "sparse_tokens": 26433.0,
      "step": 10754,
      "turn_loss": 0.25165441632270813,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 2309.0,
      "epoch": 0.49967478163910056,
      "grad_norm": 1.1494861841201782,
      "learning_rate": 2.689739243314582e-07,
      "loss": 0.287,
      "mae_dtheta": 0.043656088411808014,
      "mae_dx": 0.01400074828416109,
      "mae_dy": 0.018559396266937256,
      "pose_mae_dtheta": 0.31303635239601135,
      "pose_mae_dx": 0.12297385185956955,
      "pose_mae_dy": 0.19456341862678528,
      "pose_rmse_dtheta": 0.6141302585601807,
      "pose_rmse_dx": 0.22288508713245392,
      "pose_rmse_dy": 0.3754015862941742,
      "pose_rmse_mean": 0.40413898229599,
      "rmse_dtheta": 0.062121327966451645,
      "rmse_dx": 0.022529179230332375,
      "rmse_dy": 0.02247975394129753,
      "rmse_mean": 0.03571008890867233,
      "rotation_flip": 0.0,
      "sparse_tokens": 2059.0,
      "step": 10755,
      "turn_loss": 0.36425086855888367,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.49972124140494334,
      "grad_norm": 0.46168580651283264,
      "learning_rate": 2.68546263102204e-07,
      "loss": 0.1228,
      "mae_dtheta": 0.034619320183992386,
      "mae_dx": 0.00579399848356843,
      "mae_dy": 0.002494867891073227,
      "pose_mae_dtheta": 0.2546939551830292,
      "pose_mae_dx": 0.03905082121491432,
      "pose_mae_dy": 0.02507997490465641,
      "pose_rmse_dtheta": 0.5466282963752747,
      "pose_rmse_dx": 0.09045662730932236,
      "pose_rmse_dy": 0.05543150007724762,
      "pose_rmse_mean": 0.230838805437088,
      "rmse_dtheta": 0.05858522653579712,
      "rmse_dx": 0.014286329038441181,
      "rmse_dy": 0.005473214667290449,
      "rmse_mean": 0.026114923879504204,
      "rotation_flip": 0.01875000074505806,
      "sparse_tokens": 5753.0,
      "step": 10756,
      "turn_loss": 0.20324262976646423,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.4997677011707861,
      "grad_norm": 0.5235193371772766,
      "learning_rate": 2.681189327460504e-07,
      "loss": 0.1198,
      "mae_dtheta": 0.008257816545665264,
      "mae_dx": 0.0020805455278605223,
      "mae_dy": 0.0016802665777504444,
      "pose_mae_dtheta": 0.0577966645359993,
      "pose_mae_dx": 0.02308252826333046,
      "pose_mae_dy": 0.023111987859010696,
      "pose_rmse_dtheta": 0.14106561243534088,
      "pose_rmse_dx": 0.07124926149845123,
      "pose_rmse_dy": 0.06458959728479385,
      "pose_rmse_mean": 0.09230148792266846,
      "rmse_dtheta": 0.0178519356995821,
      "rmse_dx": 0.007575584575533867,
      "rmse_dy": 0.003933304455131292,
      "rmse_mean": 0.009786942042410374,
      "rotation_flip": 0.002481389557942748,
      "sparse_tokens": 32057.0,
      "step": 10757,
      "turn_loss": 0.10078471899032593,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.4998141609366289,
      "grad_norm": 0.3958068788051605,
      "learning_rate": 2.676919332928785e-07,
      "loss": 0.1091,
      "mae_dtheta": 0.04657525196671486,
      "mae_dx": 0.009477315470576286,
      "mae_dy": 0.007649871055036783,
      "pose_mae_dtheta": 0.3482789695262909,
      "pose_mae_dx": 0.06964541226625443,
      "pose_mae_dy": 0.053038064390420914,
      "pose_rmse_dtheta": 0.6296982169151306,
      "pose_rmse_dx": 0.1592552214860916,
      "pose_rmse_dy": 0.13794563710689545,
      "pose_rmse_mean": 0.30896636843681335,
      "rmse_dtheta": 0.06883808970451355,
      "rmse_dx": 0.019978273659944534,
      "rmse_dy": 0.017246177420020103,
      "rmse_mean": 0.03535418212413788,
      "rotation_flip": 0.019607843831181526,
      "sparse_tokens": 7025.0,
      "step": 10758,
      "turn_loss": 0.40196752548217773,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.49986062070247167,
      "grad_norm": 0.46080297231674194,
      "learning_rate": 2.6726526477254986e-07,
      "loss": 0.1188,
      "mae_dtheta": 0.008534587919712067,
      "mae_dx": 0.0016228902386501431,
      "mae_dy": 0.0019568868447095156,
      "pose_mae_dtheta": 0.055910300463438034,
      "pose_mae_dx": 0.019049976021051407,
      "pose_mae_dy": 0.02107175439596176,
      "pose_rmse_dtheta": 0.1365228146314621,
      "pose_rmse_dx": 0.053600113838911057,
      "pose_rmse_dy": 0.05003711208701134,
      "pose_rmse_mean": 0.08005335181951523,
      "rmse_dtheta": 0.02015988714993,
      "rmse_dx": 0.0053403982892632484,
      "rmse_dy": 0.005349168553948402,
      "rmse_mean": 0.010283151641488075,
      "rotation_flip": 0.004968944005668163,
      "sparse_tokens": 32105.0,
      "step": 10759,
      "turn_loss": 0.07441861927509308,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.49990708046831445,
      "grad_norm": 0.47624680399894714,
      "learning_rate": 2.668389272149019e-07,
      "loss": 0.084,
      "mae_dtheta": 0.008359750732779503,
      "mae_dx": 0.0014379561180248857,
      "mae_dy": 0.0019376184791326523,
      "pose_mae_dtheta": 0.053401172161102295,
      "pose_mae_dx": 0.022746631875634193,
      "pose_mae_dy": 0.02452710084617138,
      "pose_rmse_dtheta": 0.11811226606369019,
      "pose_rmse_dx": 0.06094823032617569,
      "pose_rmse_dy": 0.06131453812122345,
      "pose_rmse_mean": 0.08012501150369644,
      "rmse_dtheta": 0.018394729122519493,
      "rmse_dx": 0.0036470070481300354,
      "rmse_dy": 0.004363792948424816,
      "rmse_mean": 0.008801843039691448,
      "rotation_flip": 0.0015816527884453535,
      "sparse_tokens": 32121.0,
      "step": 10760,
      "turn_loss": 0.06997915357351303,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.4999535402341572,
      "grad_norm": 0.4625307023525238,
      "learning_rate": 2.664129206497479e-07,
      "loss": 0.1219,
      "mae_dtheta": 0.012798164039850235,
      "mae_dx": 0.002498902613297105,
      "mae_dy": 0.003915955312550068,
      "pose_mae_dtheta": 0.09918364882469177,
      "pose_mae_dx": 0.03522797301411629,
      "pose_mae_dy": 0.03939923644065857,
      "pose_rmse_dtheta": 0.23653392493724823,
      "pose_rmse_dx": 0.09696854650974274,
      "pose_rmse_dy": 0.09618858247995377,
      "pose_rmse_mean": 0.1432303488254547,
      "rmse_dtheta": 0.02690776437520981,
      "rmse_dx": 0.007253650575876236,
      "rmse_dy": 0.008701588958501816,
      "rmse_mean": 0.014287668280303478,
      "rotation_flip": 0.006412825547158718,
      "sparse_tokens": 32041.0,
      "step": 10761,
      "turn_loss": 0.11780644208192825,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15221.0,
      "epoch": 0.5,
      "grad_norm": 0.4558040499687195,
      "learning_rate": 2.6598724510687954e-07,
      "loss": 0.1286,
      "mae_dtheta": 0.03384969010949135,
      "mae_dx": 0.009699639864265919,
      "mae_dy": 0.006787488237023354,
      "pose_mae_dtheta": 0.2634885609149933,
      "pose_mae_dx": 0.07653948664665222,
      "pose_mae_dy": 0.08696187287569046,
      "pose_rmse_dtheta": 0.45687881112098694,
      "pose_rmse_dx": 0.165074422955513,
      "pose_rmse_dy": 0.17968912422657013,
      "pose_rmse_mean": 0.2672141194343567,
      "rmse_dtheta": 0.052102383226156235,
      "rmse_dx": 0.020511435344815254,
      "rmse_dy": 0.011352751404047012,
      "rmse_mean": 0.0279888566583395,
      "rotation_flip": 0.005148005206137896,
      "sparse_tokens": 11977.0,
      "step": 10762,
      "turn_loss": 0.2704183757305145,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 18126.0,
      "epoch": 0.5000464597658428,
      "grad_norm": 0.5257769227027893,
      "learning_rate": 2.6556190061606423e-07,
      "loss": 0.1146,
      "mae_dtheta": 0.038620639592409134,
      "mae_dx": 0.01379151176661253,
      "mae_dy": 0.002336562378332019,
      "pose_mae_dtheta": 0.3244370222091675,
      "pose_mae_dx": 0.10256945341825485,
      "pose_mae_dy": 0.02945406176149845,
      "pose_rmse_dtheta": 0.600814700126648,
      "pose_rmse_dx": 0.24115876853466034,
      "pose_rmse_dy": 0.08784663677215576,
      "pose_rmse_mean": 0.30994004011154175,
      "rmse_dtheta": 0.06062896177172661,
      "rmse_dx": 0.026913249865174294,
      "rmse_dy": 0.005350667983293533,
      "rmse_mean": 0.03096429631114006,
      "rotation_flip": 0.010596026666462421,
      "sparse_tokens": 13996.0,
      "step": 10763,
      "turn_loss": 0.19404183328151703,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.5000929195316856,
      "grad_norm": 0.7021302580833435,
      "learning_rate": 2.6513688720704533e-07,
      "loss": 0.1462,
      "mae_dtheta": 0.03137524425983429,
      "mae_dx": 0.009971617721021175,
      "mae_dy": 0.01203975547105074,
      "pose_mae_dtheta": 0.21905651688575745,
      "pose_mae_dx": 0.0861252099275589,
      "pose_mae_dy": 0.14591965079307556,
      "pose_rmse_dtheta": 0.3436785936355591,
      "pose_rmse_dx": 0.17386555671691895,
      "pose_rmse_dy": 0.2776145935058594,
      "pose_rmse_mean": 0.2650529146194458,
      "rmse_dtheta": 0.04669059440493584,
      "rmse_dx": 0.020537948235869408,
      "rmse_dy": 0.022527635097503662,
      "rmse_mean": 0.029918726533651352,
      "rotation_flip": 0.020040079951286316,
      "sparse_tokens": 9404.0,
      "step": 10764,
      "turn_loss": 0.4586736857891083,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5001393792975284,
      "grad_norm": 0.5298366546630859,
      "learning_rate": 2.647122049095463e-07,
      "loss": 0.1441,
      "mae_dtheta": 0.010803746059536934,
      "mae_dx": 0.0014371901052072644,
      "mae_dy": 0.002727080835029483,
      "pose_mae_dtheta": 0.06806815415620804,
      "pose_mae_dx": 0.019316762685775757,
      "pose_mae_dy": 0.028977638110518456,
      "pose_rmse_dtheta": 0.15843632817268372,
      "pose_rmse_dx": 0.054679449647665024,
      "pose_rmse_dy": 0.07623378932476044,
      "pose_rmse_mean": 0.0964498519897461,
      "rmse_dtheta": 0.02360292710363865,
      "rmse_dx": 0.004433377645909786,
      "rmse_dy": 0.0067280363291502,
      "rmse_mean": 0.011588114313781261,
      "rotation_flip": 0.006778309587389231,
      "sparse_tokens": 32121.0,
      "step": 10765,
      "turn_loss": 0.10288842767477036,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 38938.0,
      "epoch": 0.5001858390633711,
      "grad_norm": 0.6780446767807007,
      "learning_rate": 2.6428785375326337e-07,
      "loss": 0.1911,
      "mae_dtheta": 0.03904508426785469,
      "mae_dx": 0.010616157203912735,
      "mae_dy": 0.004622328095138073,
      "pose_mae_dtheta": 0.3122120797634125,
      "pose_mae_dx": 0.08231805264949799,
      "pose_mae_dy": 0.05466773360967636,
      "pose_rmse_dtheta": 0.5520095229148865,
      "pose_rmse_dx": 0.18589545786380768,
      "pose_rmse_dy": 0.11879521608352661,
      "pose_rmse_mean": 0.2855667471885681,
      "rmse_dtheta": 0.05841871723532677,
      "rmse_dx": 0.022011181339621544,
      "rmse_dy": 0.008743369951844215,
      "rmse_mean": 0.029724422842264175,
      "rotation_flip": 0.014675052836537361,
      "sparse_tokens": 29938.0,
      "step": 10766,
      "turn_loss": 0.24878400564193726,
      "turns": 120.0,
      "turns_per_sample": 120.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5002322988292139,
      "grad_norm": 0.6885095834732056,
      "learning_rate": 2.638638337678734e-07,
      "loss": 0.179,
      "mae_dtheta": 0.008160440251231194,
      "mae_dx": 0.0014812680892646313,
      "mae_dy": 0.0017879896331578493,
      "pose_mae_dtheta": 0.05865934491157532,
      "pose_mae_dx": 0.01466591376811266,
      "pose_mae_dy": 0.02064102701842785,
      "pose_rmse_dtheta": 0.1619543433189392,
      "pose_rmse_dx": 0.04569850489497185,
      "pose_rmse_dy": 0.06023276224732399,
      "pose_rmse_mean": 0.08929520845413208,
      "rmse_dtheta": 0.020939934998750687,
      "rmse_dx": 0.005156338214874268,
      "rmse_dy": 0.006078979000449181,
      "rmse_mean": 0.010725083760917187,
      "rotation_flip": 0.004825737327337265,
      "sparse_tokens": 32089.0,
      "step": 10767,
      "turn_loss": 0.06203685700893402,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.5002787585950567,
      "grad_norm": 0.7307848930358887,
      "learning_rate": 2.634401449830271e-07,
      "loss": 0.102,
      "mae_dtheta": 0.03271356597542763,
      "mae_dx": 0.007519657723605633,
      "mae_dy": 0.004692211281508207,
      "pose_mae_dtheta": 0.23157453536987305,
      "pose_mae_dx": 0.05541813746094704,
      "pose_mae_dy": 0.05371522903442383,
      "pose_rmse_dtheta": 0.4205608069896698,
      "pose_rmse_dx": 0.11986938863992691,
      "pose_rmse_dy": 0.10671337693929672,
      "pose_rmse_mean": 0.21571451425552368,
      "rmse_dtheta": 0.050266165286302567,
      "rmse_dx": 0.018053453415632248,
      "rmse_dy": 0.008629199117422104,
      "rmse_mean": 0.025649607181549072,
      "rotation_flip": 0.010294117964804173,
      "sparse_tokens": 10411.0,
      "step": 10768,
      "turn_loss": 0.26886335015296936,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5003252183608995,
      "grad_norm": 0.6941146850585938,
      "learning_rate": 2.63016787428354e-07,
      "loss": 0.1357,
      "mae_dtheta": 0.010347399860620499,
      "mae_dx": 0.0017368471017107368,
      "mae_dy": 0.0024201241321861744,
      "pose_mae_dtheta": 0.07778652757406235,
      "pose_mae_dx": 0.0187641941010952,
      "pose_mae_dy": 0.02406545914709568,
      "pose_rmse_dtheta": 0.22389206290245056,
      "pose_rmse_dx": 0.04747738689184189,
      "pose_rmse_dy": 0.054903026670217514,
      "pose_rmse_mean": 0.10875749588012695,
      "rmse_dtheta": 0.02471461333334446,
      "rmse_dx": 0.007189935073256493,
      "rmse_dy": 0.006118559278547764,
      "rmse_mean": 0.012674368917942047,
      "rotation_flip": 0.0024590163957327604,
      "sparse_tokens": 32057.0,
      "step": 10769,
      "turn_loss": 0.09509197622537613,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5003716781267422,
      "grad_norm": 0.48889774084091187,
      "learning_rate": 2.625937611334589e-07,
      "loss": 0.0966,
      "mae_dtheta": 0.007826272398233414,
      "mae_dx": 0.001198320765979588,
      "mae_dy": 0.0017367940163239837,
      "pose_mae_dtheta": 0.056346748024225235,
      "pose_mae_dx": 0.017452461645007133,
      "pose_mae_dy": 0.023562133312225342,
      "pose_rmse_dtheta": 0.17086432874202728,
      "pose_rmse_dx": 0.0543094165623188,
      "pose_rmse_dy": 0.07627000659704208,
      "pose_rmse_mean": 0.10048125684261322,
      "rmse_dtheta": 0.019622167572379112,
      "rmse_dx": 0.0039178854785859585,
      "rmse_dy": 0.004625014495104551,
      "rmse_mean": 0.00938835646957159,
      "rotation_flip": 0.006164685357362032,
      "sparse_tokens": 32089.0,
      "step": 10770,
      "turn_loss": 0.06310296058654785,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.500418137892585,
      "grad_norm": 0.35693103075027466,
      "learning_rate": 2.621710661279253e-07,
      "loss": 0.1112,
      "mae_dtheta": 0.025495782494544983,
      "mae_dx": 0.010370224714279175,
      "mae_dy": 0.004369914997369051,
      "pose_mae_dtheta": 0.1794695407152176,
      "pose_mae_dx": 0.08066508919000626,
      "pose_mae_dy": 0.04417569562792778,
      "pose_rmse_dtheta": 0.3501473069190979,
      "pose_rmse_dx": 0.2031586766242981,
      "pose_rmse_dy": 0.12911877036094666,
      "pose_rmse_mean": 0.22747492790222168,
      "rmse_dtheta": 0.04313500225543976,
      "rmse_dx": 0.022757429629564285,
      "rmse_dy": 0.011914126574993134,
      "rmse_mean": 0.025935519486665726,
      "rotation_flip": 0.012672810815274715,
      "sparse_tokens": 15463.0,
      "step": 10771,
      "turn_loss": 0.2284833788871765,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5004645976584278,
      "grad_norm": 0.5138828754425049,
      "learning_rate": 2.6174870244131235e-07,
      "loss": 0.1075,
      "mae_dtheta": 0.008152137510478497,
      "mae_dx": 0.0015447968617081642,
      "mae_dy": 0.001927603385411203,
      "pose_mae_dtheta": 0.04744287207722664,
      "pose_mae_dx": 0.017620937898755074,
      "pose_mae_dy": 0.022796139121055603,
      "pose_rmse_dtheta": 0.08591020107269287,
      "pose_rmse_dx": 0.036391839385032654,
      "pose_rmse_dy": 0.047227054834365845,
      "pose_rmse_mean": 0.056509699672460556,
      "rmse_dtheta": 0.01573925092816353,
      "rmse_dx": 0.004279079381376505,
      "rmse_dy": 0.0036593982949852943,
      "rmse_mean": 0.007892576977610588,
      "rotation_flip": 0.00226171244867146,
      "sparse_tokens": 32137.0,
      "step": 10772,
      "turn_loss": 0.08071283251047134,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5005110574242706,
      "grad_norm": 0.48888933658599854,
      "learning_rate": 2.613266701031547e-07,
      "loss": 0.1443,
      "mae_dtheta": 0.006083938758820295,
      "mae_dx": 0.0011439339723438025,
      "mae_dy": 0.0006416829419322312,
      "pose_mae_dtheta": 0.03977539390325546,
      "pose_mae_dx": 0.01058601588010788,
      "pose_mae_dy": 0.011234169825911522,
      "pose_rmse_dtheta": 0.14232581853866577,
      "pose_rmse_dx": 0.04466928169131279,
      "pose_rmse_dy": 0.0346810482442379,
      "pose_rmse_mean": 0.07389205694198608,
      "rmse_dtheta": 0.020529216155409813,
      "rmse_dx": 0.004694035742431879,
      "rmse_dy": 0.0015465260948985815,
      "rmse_mean": 0.008923259563744068,
      "rotation_flip": 0.002565747359767556,
      "sparse_tokens": 32089.0,
      "step": 10773,
      "turn_loss": 0.04062124714255333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5005575171901133,
      "grad_norm": 0.42662230134010315,
      "learning_rate": 2.609049691429677e-07,
      "loss": 0.1022,
      "mae_dtheta": 0.006167133804410696,
      "mae_dx": 0.004846814088523388,
      "mae_dy": 0.0011111906496807933,
      "pose_mae_dtheta": 0.044714540243148804,
      "pose_mae_dx": 0.042757079005241394,
      "pose_mae_dy": 0.014351942576467991,
      "pose_rmse_dtheta": 0.1459859162569046,
      "pose_rmse_dx": 0.15467217564582825,
      "pose_rmse_dy": 0.051926709711551666,
      "pose_rmse_mean": 0.1175282746553421,
      "rmse_dtheta": 0.018252236768603325,
      "rmse_dx": 0.015409938991069794,
      "rmse_dy": 0.003938494250178337,
      "rmse_mean": 0.012533558532595634,
      "rotation_flip": 0.005560704506933689,
      "sparse_tokens": 32073.0,
      "step": 10774,
      "turn_loss": 0.06506794691085815,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.5006039769559562,
      "grad_norm": 0.4331262409687042,
      "learning_rate": 2.604835995902388e-07,
      "loss": 0.1194,
      "mae_dtheta": 0.0068845911882817745,
      "mae_dx": 0.0015179426409304142,
      "mae_dy": 0.0017171098152175546,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.43312618136405945,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.8697967529297,
      "model/head/act_norm_mean": 112.5104462594697,
      "model/head/act_norm_min": 60.239559173583984,
      "model/head/act_over_embed": 77.31823200890109,
      "model/head/grad_frac": 0.10269701480865479,
      "model/head/grad_norm": 0.04448076710104942,
      "model/head/grad_zero_frac": 0.00020813028095290065,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6944493765782829,
      "model/head/update_ratio": 0.0007572002941742539,
      "model/head/weight_delta": 9.977359771728516,
      "model/head/weight_delta_rel": 0.17503243684768677,
      "model/head/weight_norm": 58.74372863769531,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229085147380829,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42284303928518896,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227677881717682,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905816953156863,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09206356108188629,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03987513855099678,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5546139513598326,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012875422835350037,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1553006172180176,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10309350490570068,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96996307373047,
      "model/modality_embedder/grad_frac": 0.09206356108188629,
      "model/modality_embedder/grad_norm": 0.03987513855099678,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5546139513598326,
      "model/modality_embedder/update_ratio": 0.0012875422835350037,
      "model/modality_embedder/weight_delta": 3.1553006172180176,
      "model/modality_embedder/weight_delta_rel": 0.10309350490570068,
      "model/modality_embedder/weight_norm": 30.96996307373047,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.24410247802734,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.927506713965048,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.088785171508789,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.443206626684017,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0796491801738739,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03449814394116402,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012338258093222976,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7381787300109863,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09978088736534119,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960304260253906,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.68912506103516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.930665784832453,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.25306510925293,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.132586931907287,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0846121609210968,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.0366477407515049,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012310650199651718,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.471501111984253,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12025551497936249,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.769134521484375,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.31785583496094,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.74087852733686,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.179716110229492,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.376582076035024,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09013497084379196,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.039039816707372665,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012699711369350553,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7608413696289062,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1262820065021515,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.740713119506836,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.07286834716797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.42695306236973,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.852201461791992,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.53526828178811,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.11887799203395844,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.051489170640707016,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00012104583584005013,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017189233331009746,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2323570251464844,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1104666218161583,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954315185546875,
      "model/normalizer/grad_frac": 0.41166508197784424,
      "model/normalizer/grad_norm": 0.17830292880535126,
      "model/normalizer/grad_zero_frac": 0.00018789641035255045,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002266863826662302,
      "model/normalizer/weight_delta": 6.798449993133545,
      "model/normalizer/weight_delta_rel": 0.08756010234355927,
      "model/normalizer/weight_norm": 78.65621185302734,
      "pose_mae_dtheta": 0.04586901515722275,
      "pose_mae_dx": 0.016490858048200607,
      "pose_mae_dy": 0.019992591813206673,
      "pose_rmse_dtheta": 0.11090684682130814,
      "pose_rmse_dx": 0.040491268038749695,
      "pose_rmse_dy": 0.05881085991859436,
      "pose_rmse_mean": 0.07006966322660446,
      "rmse_dtheta": 0.017113637179136276,
      "rmse_dx": 0.003711102530360222,
      "rmse_dy": 0.0046622538939118385,
      "rmse_mean": 0.008495665155351162,
      "rotation_flip": 0.0019091255962848663,
      "sparse_tokens": 32233.0,
      "step": 10775,
      "turn_loss": 0.06660990417003632,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10698.0,
      "epoch": 0.5006504367217989,
      "grad_norm": 0.5835599303245544,
      "learning_rate": 2.6006256147443675e-07,
      "loss": 0.1629,
      "mae_dtheta": 0.026576336473226547,
      "mae_dx": 0.01907321624457836,
      "mae_dy": 0.005803222768008709,
      "pose_mae_dtheta": 0.17481818795204163,
      "pose_mae_dx": 0.17495088279247284,
      "pose_mae_dy": 0.08678300678730011,
      "pose_rmse_dtheta": 0.3133033215999603,
      "pose_rmse_dx": 0.3265712559223175,
      "pose_rmse_dy": 0.16688485443592072,
      "pose_rmse_mean": 0.26891982555389404,
      "rmse_dtheta": 0.039426423609256744,
      "rmse_dx": 0.03375568613409996,
      "rmse_dy": 0.008915746584534645,
      "rmse_mean": 0.027365950867533684,
      "rotation_flip": 0.0021505376789718866,
      "sparse_tokens": 8905.0,
      "step": 10776,
      "turn_loss": 0.3178139925003052,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.5006968964876417,
      "grad_norm": 0.3781673312187195,
      "learning_rate": 2.596418548250029e-07,
      "loss": 0.078,
      "mae_dtheta": 0.03823447972536087,
      "mae_dx": 0.018539855256676674,
      "mae_dy": 0.01303737424314022,
      "pose_mae_dtheta": 0.343181848526001,
      "pose_mae_dx": 0.16399329900741577,
      "pose_mae_dy": 0.19948825240135193,
      "pose_rmse_dtheta": 0.5202849507331848,
      "pose_rmse_dx": 0.2780616283416748,
      "pose_rmse_dy": 0.36513376235961914,
      "pose_rmse_mean": 0.3878267705440521,
      "rmse_dtheta": 0.05488056316971779,
      "rmse_dx": 0.03087473288178444,
      "rmse_dy": 0.020111415535211563,
      "rmse_mean": 0.03528890758752823,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 2988.0,
      "step": 10777,
      "turn_loss": 0.38773953914642334,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5007433562534844,
      "grad_norm": 0.41276371479034424,
      "learning_rate": 2.5922147967135824e-07,
      "loss": 0.0756,
      "mae_dtheta": 0.008161470293998718,
      "mae_dx": 0.0012479365104809403,
      "mae_dy": 0.0011615402763709426,
      "pose_mae_dtheta": 0.05632380396127701,
      "pose_mae_dx": 0.01336073037236929,
      "pose_mae_dy": 0.01638123020529747,
      "pose_rmse_dtheta": 0.1898728609085083,
      "pose_rmse_dx": 0.03957035019993782,
      "pose_rmse_dy": 0.04006504267454147,
      "pose_rmse_mean": 0.08983608335256577,
      "rmse_dtheta": 0.023289494216442108,
      "rmse_dx": 0.004480018280446529,
      "rmse_dy": 0.002557925181463361,
      "rmse_mean": 0.010109147056937218,
      "rotation_flip": 0.002627430483698845,
      "sparse_tokens": 32073.0,
      "step": 10778,
      "turn_loss": 0.06013815850019455,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.5007898160193273,
      "grad_norm": 0.37336766719818115,
      "learning_rate": 2.588014360429009e-07,
      "loss": 0.1056,
      "mae_dtheta": 0.033058274537324905,
      "mae_dx": 0.008860975503921509,
      "mae_dy": 0.0033070696517825127,
      "pose_mae_dtheta": 0.24033167958259583,
      "pose_mae_dx": 0.06569820642471313,
      "pose_mae_dy": 0.04149775579571724,
      "pose_rmse_dtheta": 0.41895610094070435,
      "pose_rmse_dx": 0.16189570724964142,
      "pose_rmse_dy": 0.0867350772023201,
      "pose_rmse_mean": 0.22252896428108215,
      "rmse_dtheta": 0.051126062870025635,
      "rmse_dx": 0.020488495007157326,
      "rmse_dy": 0.006150553934276104,
      "rmse_mean": 0.02592170238494873,
      "rotation_flip": 0.010471204295754433,
      "sparse_tokens": 9473.0,
      "step": 10779,
      "turn_loss": 0.24878136813640594,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5008362757851701,
      "grad_norm": 0.4758860468864441,
      "learning_rate": 2.583817239690034e-07,
      "loss": 0.1006,
      "mae_dtheta": 0.010106069035828114,
      "mae_dx": 0.001836138078942895,
      "mae_dy": 0.003248384455218911,
      "pose_mae_dtheta": 0.06661670655012131,
      "pose_mae_dx": 0.025023559108376503,
      "pose_mae_dy": 0.03146570920944214,
      "pose_rmse_dtheta": 0.17101642489433289,
      "pose_rmse_dx": 0.08033820986747742,
      "pose_rmse_dy": 0.06952416151762009,
      "pose_rmse_mean": 0.10695960372686386,
      "rmse_dtheta": 0.02195596881210804,
      "rmse_dx": 0.0058796158991754055,
      "rmse_dy": 0.007224930915981531,
      "rmse_mean": 0.011686839163303375,
      "rotation_flip": 0.006974040996283293,
      "sparse_tokens": 32041.0,
      "step": 10780,
      "turn_loss": 0.09726129472255707,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.5008827355510128,
      "grad_norm": 1.2747352123260498,
      "learning_rate": 2.579623434790174e-07,
      "loss": 0.2865,
      "mae_dtheta": 0.03596634790301323,
      "mae_dx": 0.017614075914025307,
      "mae_dy": 0.008942054584622383,
      "pose_mae_dtheta": 0.24819661676883698,
      "pose_mae_dx": 0.1053493395447731,
      "pose_mae_dy": 0.08190213888883591,
      "pose_rmse_dtheta": 0.38383162021636963,
      "pose_rmse_dx": 0.19243848323822021,
      "pose_rmse_dy": 0.14601992070674896,
      "pose_rmse_mean": 0.2407633513212204,
      "rmse_dtheta": 0.05007980763912201,
      "rmse_dx": 0.030398128554224968,
      "rmse_dy": 0.01359100453555584,
      "rmse_mean": 0.031356316059827805,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 4759.0,
      "step": 10781,
      "turn_loss": 0.3184870481491089,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5009291953168556,
      "grad_norm": 0.38053828477859497,
      "learning_rate": 2.5754329460226933e-07,
      "loss": 0.0842,
      "mae_dtheta": 0.005423933267593384,
      "mae_dx": 0.0008320268825627863,
      "mae_dy": 0.0005337327602319419,
      "pose_mae_dtheta": 0.03690573573112488,
      "pose_mae_dx": 0.008198961615562439,
      "pose_mae_dy": 0.007763430941849947,
      "pose_rmse_dtheta": 0.18375836312770844,
      "pose_rmse_dx": 0.0253240168094635,
      "pose_rmse_dy": 0.024657703936100006,
      "pose_rmse_mean": 0.07791336625814438,
      "rmse_dtheta": 0.022706547752022743,
      "rmse_dx": 0.0028270422481000423,
      "rmse_dy": 0.0016185023123398423,
      "rmse_mean": 0.009050698019564152,
      "rotation_flip": 0.0013860013568773866,
      "sparse_tokens": 32121.0,
      "step": 10782,
      "turn_loss": 0.03808264061808586,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.5009756550826984,
      "grad_norm": 0.4781759977340698,
      "learning_rate": 2.571245773680647e-07,
      "loss": 0.111,
      "mae_dtheta": 0.0266281608492136,
      "mae_dx": 0.005382265895605087,
      "mae_dy": 0.002018783940002322,
      "pose_mae_dtheta": 0.2294110208749771,
      "pose_mae_dx": 0.038285575807094574,
      "pose_mae_dy": 0.024053212255239487,
      "pose_rmse_dtheta": 0.46115413308143616,
      "pose_rmse_dx": 0.09065202623605728,
      "pose_rmse_dy": 0.06149154528975487,
      "pose_rmse_mean": 0.20443257689476013,
      "rmse_dtheta": 0.04632452130317688,
      "rmse_dx": 0.01284897793084383,
      "rmse_dy": 0.00416047777980566,
      "rmse_mean": 0.021111324429512024,
      "rotation_flip": 0.007155634928494692,
      "sparse_tokens": 10389.0,
      "step": 10783,
      "turn_loss": 0.1373632401227951,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.5010221148485412,
      "grad_norm": 0.5226137042045593,
      "learning_rate": 2.5670619180568347e-07,
      "loss": 0.0874,
      "mae_dtheta": 0.014499103650450706,
      "mae_dx": 0.00634358124807477,
      "mae_dy": 0.0025220902170985937,
      "pose_mae_dtheta": 0.11400816589593887,
      "pose_mae_dx": 0.05839613452553749,
      "pose_mae_dy": 0.052149031311273575,
      "pose_rmse_dtheta": 0.24929319322109222,
      "pose_rmse_dx": 0.20002040266990662,
      "pose_rmse_dy": 0.12686815857887268,
      "pose_rmse_mean": 0.19206058979034424,
      "rmse_dtheta": 0.02905305288732052,
      "rmse_dx": 0.01936645247042179,
      "rmse_dy": 0.005241463892161846,
      "rmse_mean": 0.017886990681290627,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 13826.0,
      "step": 10784,
      "turn_loss": 0.08676323294639587,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5010685746143839,
      "grad_norm": 0.5738474130630493,
      "learning_rate": 2.5628813794438434e-07,
      "loss": 0.1364,
      "mae_dtheta": 0.014210131019353867,
      "mae_dx": 0.0025528979022055864,
      "mae_dy": 0.0033055180683732033,
      "pose_mae_dtheta": 0.10141170769929886,
      "pose_mae_dx": 0.032173749059438705,
      "pose_mae_dy": 0.03568181395530701,
      "pose_rmse_dtheta": 0.25579914450645447,
      "pose_rmse_dx": 0.07998744398355484,
      "pose_rmse_dy": 0.07434028387069702,
      "pose_rmse_mean": 0.13670895993709564,
      "rmse_dtheta": 0.02952936850488186,
      "rmse_dx": 0.008275551721453667,
      "rmse_dy": 0.007349993567913771,
      "rmse_mean": 0.015051638707518578,
      "rotation_flip": 0.007641542237251997,
      "sparse_tokens": 32073.0,
      "step": 10785,
      "turn_loss": 0.13300471007823944,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5011150343802268,
      "grad_norm": 0.34589576721191406,
      "learning_rate": 2.5587041581340235e-07,
      "loss": 0.0599,
      "mae_dtheta": 0.009714821353554726,
      "mae_dx": 0.001168311689980328,
      "mae_dy": 0.0014962907880544662,
      "pose_mae_dtheta": 0.07039956748485565,
      "pose_mae_dx": 0.014405973255634308,
      "pose_mae_dy": 0.019844098016619682,
      "pose_rmse_dtheta": 0.23271188139915466,
      "pose_rmse_dx": 0.041444625705480576,
      "pose_rmse_dy": 0.051126983016729355,
      "pose_rmse_mean": 0.10842783749103546,
      "rmse_dtheta": 0.026035748422145844,
      "rmse_dx": 0.00383914727717638,
      "rmse_dy": 0.0036178319714963436,
      "rmse_mean": 0.011164242401719093,
      "rotation_flip": 0.0024485797621309757,
      "sparse_tokens": 32089.0,
      "step": 10786,
      "turn_loss": 0.0664634257555008,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.5011614941460695,
      "grad_norm": 0.5854806900024414,
      "learning_rate": 2.5545302544194737e-07,
      "loss": 0.1494,
      "mae_dtheta": 0.029376454651355743,
      "mae_dx": 0.012038405984640121,
      "mae_dy": 0.0031070176046341658,
      "pose_mae_dtheta": 0.22496397793293,
      "pose_mae_dx": 0.09700595587491989,
      "pose_mae_dy": 0.04259638488292694,
      "pose_rmse_dtheta": 0.3819277584552765,
      "pose_rmse_dx": 0.20444746315479279,
      "pose_rmse_dy": 0.10449256002902985,
      "pose_rmse_mean": 0.2302892655134201,
      "rmse_dtheta": 0.046579256653785706,
      "rmse_dx": 0.024597205221652985,
      "rmse_dy": 0.00563316373154521,
      "rmse_mean": 0.02560320869088173,
      "rotation_flip": 0.020497804507613182,
      "sparse_tokens": 11845.0,
      "step": 10787,
      "turn_loss": 0.20591561496257782,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.5012079539119123,
      "grad_norm": 0.8199111223220825,
      "learning_rate": 2.5503596685921007e-07,
      "loss": 0.2389,
      "mae_dtheta": 0.03324870020151138,
      "mae_dx": 0.0061569600366055965,
      "mae_dy": 0.002595713594928384,
      "pose_mae_dtheta": 0.27291378378868103,
      "pose_mae_dx": 0.04507198557257652,
      "pose_mae_dy": 0.019651886075735092,
      "pose_rmse_dtheta": 0.5383803844451904,
      "pose_rmse_dx": 0.1087254211306572,
      "pose_rmse_dy": 0.04281581565737724,
      "pose_rmse_mean": 0.22997388243675232,
      "rmse_dtheta": 0.05441761016845703,
      "rmse_dx": 0.014536849223077297,
      "rmse_dy": 0.005441863089799881,
      "rmse_mean": 0.02479877695441246,
      "rotation_flip": 0.008498583920300007,
      "sparse_tokens": 8221.0,
      "step": 10788,
      "turn_loss": 0.23180367052555084,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.501254413677755,
      "grad_norm": 0.3862784504890442,
      "learning_rate": 2.546192400943537e-07,
      "loss": 0.0614,
      "mae_dtheta": 0.005846248008310795,
      "mae_dx": 0.0009190355194732547,
      "mae_dy": 0.0009548627422191203,
      "pose_mae_dtheta": 0.03987636789679527,
      "pose_mae_dx": 0.009717447683215141,
      "pose_mae_dy": 0.014607609249651432,
      "pose_rmse_dtheta": 0.13091769814491272,
      "pose_rmse_dx": 0.024250073358416557,
      "pose_rmse_dy": 0.036720048636198044,
      "pose_rmse_mean": 0.06396260857582092,
      "rmse_dtheta": 0.018005209043622017,
      "rmse_dx": 0.0027806975413113832,
      "rmse_dy": 0.002137507079169154,
      "rmse_mean": 0.007641138043254614,
      "rotation_flip": 0.002274795202538371,
      "sparse_tokens": 32137.0,
      "step": 10789,
      "turn_loss": 0.03763352707028389,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.5013008734435979,
      "grad_norm": 0.3816715180873871,
      "learning_rate": 2.5420284517652107e-07,
      "loss": 0.0979,
      "mae_dtheta": 0.00966806709766388,
      "mae_dx": 0.001306832884438336,
      "mae_dy": 0.001751877716742456,
      "pose_mae_dtheta": 0.06381694227457047,
      "pose_mae_dx": 0.017676331102848053,
      "pose_mae_dy": 0.01966180093586445,
      "pose_rmse_dtheta": 0.18006205558776855,
      "pose_rmse_dx": 0.04056119546294212,
      "pose_rmse_dy": 0.04957559332251549,
      "pose_rmse_mean": 0.09006628394126892,
      "rmse_dtheta": 0.022934069857001305,
      "rmse_dx": 0.003456233534961939,
      "rmse_dy": 0.004017691593617201,
      "rmse_mean": 0.010135998949408531,
      "rotation_flip": 0.0006535947904922068,
      "sparse_tokens": 32201.0,
      "step": 10790,
      "turn_loss": 0.06055917590856552,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5013473332094406,
      "grad_norm": 0.6004022359848022,
      "learning_rate": 2.5378678213483057e-07,
      "loss": 0.0877,
      "mae_dtheta": 0.008275007829070091,
      "mae_dx": 0.001155199483036995,
      "mae_dy": 0.0021844313014298677,
      "pose_mae_dtheta": 0.05693995580077171,
      "pose_mae_dx": 0.01833060197532177,
      "pose_mae_dy": 0.02619198150932789,
      "pose_rmse_dtheta": 0.1648685187101364,
      "pose_rmse_dx": 0.0501500740647316,
      "pose_rmse_dy": 0.06961854547262192,
      "pose_rmse_mean": 0.09487905353307724,
      "rmse_dtheta": 0.020718518644571304,
      "rmse_dx": 0.003332968568429351,
      "rmse_dy": 0.005553271155804396,
      "rmse_mean": 0.009868253022432327,
      "rotation_flip": 0.001193792326375842,
      "sparse_tokens": 32089.0,
      "step": 10791,
      "turn_loss": 0.06387951225042343,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5013937929752834,
      "grad_norm": 0.5612399578094482,
      "learning_rate": 2.5337105099837777e-07,
      "loss": 0.1887,
      "mae_dtheta": 0.009675383567810059,
      "mae_dx": 0.0015070178778842092,
      "mae_dy": 0.002599140862002969,
      "pose_mae_dtheta": 0.06675950437784195,
      "pose_mae_dx": 0.02370538003742695,
      "pose_mae_dy": 0.02545534074306488,
      "pose_rmse_dtheta": 0.20945797860622406,
      "pose_rmse_dx": 0.07272560894489288,
      "pose_rmse_dy": 0.06809776276350021,
      "pose_rmse_mean": 0.11676045507192612,
      "rmse_dtheta": 0.02495712973177433,
      "rmse_dx": 0.00403226725757122,
      "rmse_dy": 0.006541056092828512,
      "rmse_mean": 0.0118434838950634,
      "rotation_flip": 0.002420330885797739,
      "sparse_tokens": 32089.0,
      "step": 10792,
      "turn_loss": 0.07952714711427689,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2309.0,
      "epoch": 0.5014402527411261,
      "grad_norm": 0.44258445501327515,
      "learning_rate": 2.529556517962356e-07,
      "loss": 0.0705,
      "mae_dtheta": 0.026187296956777573,
      "mae_dx": 0.021791288629174232,
      "mae_dy": 0.005233622156083584,
      "pose_mae_dtheta": 0.2144262194633484,
      "pose_mae_dx": 0.17871889472007751,
      "pose_mae_dy": 0.11071587353944778,
      "pose_rmse_dtheta": 0.34619808197021484,
      "pose_rmse_dx": 0.3853333592414856,
      "pose_rmse_dy": 0.1749272644519806,
      "pose_rmse_mean": 0.30215293169021606,
      "rmse_dtheta": 0.03682654723525047,
      "rmse_dx": 0.03825150802731514,
      "rmse_dy": 0.007386212237179279,
      "rmse_mean": 0.027488090097904205,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 1899.0,
      "step": 10793,
      "turn_loss": 0.16002140939235687,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.501486712506969,
      "grad_norm": 0.6713327169418335,
      "learning_rate": 2.525405845574519e-07,
      "loss": 0.1225,
      "mae_dtheta": 0.032819535583257675,
      "mae_dx": 0.011937636882066727,
      "mae_dy": 0.005075524095445871,
      "pose_mae_dtheta": 0.26607638597488403,
      "pose_mae_dx": 0.09741377830505371,
      "pose_mae_dy": 0.0521710067987442,
      "pose_rmse_dtheta": 0.46037307381629944,
      "pose_rmse_dx": 0.21513988077640533,
      "pose_rmse_dy": 0.12791796028614044,
      "pose_rmse_mean": 0.26781031489372253,
      "rmse_dtheta": 0.05069073289632797,
      "rmse_dx": 0.024390093982219696,
      "rmse_dy": 0.010090305469930172,
      "rmse_mean": 0.02839037775993347,
      "rotation_flip": 0.01729818806052208,
      "sparse_tokens": 21364.0,
      "step": 10794,
      "turn_loss": 0.23503334820270538,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5015331722728118,
      "grad_norm": 0.5612850785255432,
      "learning_rate": 2.52125849311054e-07,
      "loss": 0.1238,
      "mae_dtheta": 0.004986511077731848,
      "mae_dx": 0.000818975328002125,
      "mae_dy": 0.000804932089522481,
      "pose_mae_dtheta": 0.0348723940551281,
      "pose_mae_dx": 0.007670302875339985,
      "pose_mae_dy": 0.011981779709458351,
      "pose_rmse_dtheta": 0.11198804527521133,
      "pose_rmse_dx": 0.020949117839336395,
      "pose_rmse_dy": 0.03306951746344566,
      "pose_rmse_mean": 0.05533556267619133,
      "rmse_dtheta": 0.01577826775610447,
      "rmse_dx": 0.0027107615023851395,
      "rmse_dy": 0.0019896242301911116,
      "rmse_mean": 0.0068262177519500256,
      "rotation_flip": 0.0020942408591508865,
      "sparse_tokens": 32121.0,
      "step": 10795,
      "turn_loss": 0.037807658314704895,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.5015796320386545,
      "grad_norm": 0.4234827160835266,
      "learning_rate": 2.5171144608604317e-07,
      "loss": 0.1018,
      "mae_dtheta": 0.0317358560860157,
      "mae_dx": 0.0120824771001935,
      "mae_dy": 0.0034561101347208023,
      "pose_mae_dtheta": 0.26561954617500305,
      "pose_mae_dx": 0.0991879403591156,
      "pose_mae_dy": 0.04555784910917282,
      "pose_rmse_dtheta": 0.5036264657974243,
      "pose_rmse_dx": 0.22922858595848083,
      "pose_rmse_dy": 0.12731792032718658,
      "pose_rmse_mean": 0.286724328994751,
      "rmse_dtheta": 0.05264868959784508,
      "rmse_dx": 0.025188753381371498,
      "rmse_dy": 0.008384929969906807,
      "rmse_mean": 0.028740791603922844,
      "rotation_flip": 0.006451612804085016,
      "sparse_tokens": 15962.0,
      "step": 10796,
      "turn_loss": 0.24528831243515015,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5016260918044974,
      "grad_norm": 0.30877262353897095,
      "learning_rate": 2.5129737491139896e-07,
      "loss": 0.0741,
      "mae_dtheta": 0.00788039155304432,
      "mae_dx": 0.001099192537367344,
      "mae_dy": 0.0016095776809379458,
      "pose_mae_dtheta": 0.05054175481200218,
      "pose_mae_dx": 0.01680266484618187,
      "pose_mae_dy": 0.023737212643027306,
      "pose_rmse_dtheta": 0.10216587036848068,
      "pose_rmse_dx": 0.04120456054806709,
      "pose_rmse_dy": 0.05698390305042267,
      "pose_rmse_mean": 0.06678478419780731,
      "rmse_dtheta": 0.0156774390488863,
      "rmse_dx": 0.0034097740426659584,
      "rmse_dy": 0.0032614676747471094,
      "rmse_mean": 0.007449560798704624,
      "rotation_flip": 0.0008385744295082986,
      "sparse_tokens": 32089.0,
      "step": 10797,
      "turn_loss": 0.05917874723672867,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5016725515703401,
      "grad_norm": 0.4275309443473816,
      "learning_rate": 2.5088363581607933e-07,
      "loss": 0.0843,
      "mae_dtheta": 0.010952712967991829,
      "mae_dx": 0.001975842984393239,
      "mae_dy": 0.0019076899625360966,
      "pose_mae_dtheta": 0.07731480151414871,
      "pose_mae_dx": 0.019467996433377266,
      "pose_mae_dy": 0.02334667555987835,
      "pose_rmse_dtheta": 0.233792245388031,
      "pose_rmse_dx": 0.0560239814221859,
      "pose_rmse_dy": 0.05581550672650337,
      "pose_rmse_mean": 0.11521058529615402,
      "rmse_dtheta": 0.026582617312669754,
      "rmse_dx": 0.007072373293340206,
      "rmse_dy": 0.004174527712166309,
      "rmse_mean": 0.01260983943939209,
      "rotation_flip": 0.0020333467982709408,
      "sparse_tokens": 32089.0,
      "step": 10798,
      "turn_loss": 0.09995782375335693,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5017190113361829,
      "grad_norm": 0.38135796785354614,
      "learning_rate": 2.5047022882901563e-07,
      "loss": 0.0993,
      "mae_dtheta": 0.0137119609862566,
      "mae_dx": 0.002659963443875313,
      "mae_dy": 0.0037325462326407433,
      "pose_mae_dtheta": 0.08683569729328156,
      "pose_mae_dx": 0.02715962938964367,
      "pose_mae_dy": 0.03470735624432564,
      "pose_rmse_dtheta": 0.2047470659017563,
      "pose_rmse_dx": 0.07389409095048904,
      "pose_rmse_dy": 0.07871899008750916,
      "pose_rmse_mean": 0.1191200539469719,
      "rmse_dtheta": 0.02826850302517414,
      "rmse_dx": 0.008622400462627411,
      "rmse_dy": 0.008845171891152859,
      "rmse_mean": 0.01524535845965147,
      "rotation_flip": 0.005289139691740274,
      "sparse_tokens": 32089.0,
      "step": 10799,
      "turn_loss": 0.12313386797904968,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17859.0,
      "epoch": 0.5017654711020256,
      "grad_norm": 0.3910171687602997,
      "learning_rate": 2.50057153979118e-07,
      "loss": 0.0895,
      "mae_dtheta": 0.030901143327355385,
      "mae_dx": 0.01028260588645935,
      "mae_dy": 0.005020809825509787,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3910171389579773,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 145.43215942382812,
      "model/head/act_norm_mean": 103.83670099431818,
      "model/head/act_norm_min": 69.6788558959961,
      "model/head/act_over_embed": 71.35755305780638,
      "model/head/grad_frac": 0.09950370341539383,
      "model/head/grad_norm": 0.03890765458345413,
      "model/head/grad_zero_frac": 0.00020337120804470032,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6930397727272727,
      "model/head/update_ratio": 0.000662327220197767,
      "model/head/weight_delta": 9.977893829345703,
      "model/head/weight_delta_rel": 0.1750418096780777,
      "model/head/weight_norm": 58.74385452270508,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42291903495788574,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.422858510698591,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228108525276184,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905923274158218,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07597140967845917,
      "model/modality_embedder.encoders.pose/grad_norm": 0.02970612235367298,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5382603236607143,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009591921698302031,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1555306911468506,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10310102254152298,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969938278198242,
      "model/modality_embedder/grad_frac": 0.07597140967845917,
      "model/modality_embedder/grad_norm": 0.02970612235367298,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5382603236607143,
      "model/modality_embedder/update_ratio": 0.0009591921698302031,
      "model/modality_embedder/weight_delta": 3.1555306911468506,
      "model/modality_embedder/weight_delta_rel": 0.10310102254152298,
      "model/modality_embedder/weight_norm": 30.969938278198242,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.43913269042969,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.061882215007216,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.099926948547363,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.848341366895953,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.04769974201917648,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.018651416525244713,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0006670666043646634,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.738445520401001,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09979061037302017,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960351943969727,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.62490844726562,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.87743281024531,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.517447471618652,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.40879537124854,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.04953240975737572,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.019368020817637444,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00033287605037912726,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.000650605303235352,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4718337059020996,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12026703357696533,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76923179626465,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.12760162353516,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.490895562770564,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.63766860961914,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.517582080260176,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05561843141913414,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.021747760474681854,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00031270174076780677,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007074560853652656,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.76123046875,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1262950748205185,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.740793228149414,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.73482513427734,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.313672438672437,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.767253875732422,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.77021141448592,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05367928370833397,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.020989520475268364,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007007158710621297,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.232734441757202,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11047951877117157,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954395294189453,
      "model/normalizer/grad_frac": 0.17957057058811188,
      "model/normalizer/grad_norm": 0.07021517306566238,
      "model/normalizer/grad_zero_frac": 0.00028479896718636155,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0008926833397708833,
      "model/normalizer/weight_delta": 6.799164772033691,
      "model/normalizer/weight_delta_rel": 0.08756930381059647,
      "model/normalizer/weight_norm": 78.65630340576172,
      "pose_mae_dtheta": 0.22896677255630493,
      "pose_mae_dx": 0.07996867597103119,
      "pose_mae_dy": 0.051185209304094315,
      "pose_rmse_dtheta": 0.4148716628551483,
      "pose_rmse_dx": 0.18368765711784363,
      "pose_rmse_dy": 0.10685832053422928,
      "pose_rmse_mean": 0.23513922095298767,
      "rmse_dtheta": 0.04776932671666145,
      "rmse_dx": 0.02297467179596424,
      "rmse_dy": 0.009021291509270668,
      "rmse_mean": 0.026588430628180504,
      "rotation_flip": 0.016241298988461494,
      "sparse_tokens": 14477.0,
      "step": 10800,
      "turn_loss": 0.23159483075141907,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "epoch": 0.5017654711020256,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.303609162569046,
      "eval_objectnav_nopose_mae_dtheta": 0.03929214924573898,
      "eval_objectnav_nopose_mae_dx": 0.01282401941716671,
      "eval_objectnav_nopose_mae_dy": 0.004972727969288826,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31518176198005676,
      "eval_objectnav_nopose_pose_mae_dx": 0.10218983143568039,
      "eval_objectnav_nopose_pose_mae_dy": 0.056076645851135254,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5329415798187256,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22719824314117432,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13279499113559723,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2976449429988861,
      "eval_objectnav_nopose_rmse_dtheta": 0.056963592767715454,
      "eval_objectnav_nopose_rmse_dx": 0.02537914365530014,
      "eval_objectnav_nopose_rmse_dy": 0.010163088329136372,
      "eval_objectnav_nopose_rmse_mean": 0.03083527646958828,
      "eval_objectnav_nopose_rotation_flip": 0.01584111526608467,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.303609162569046,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 10800
    },
    {
      "epoch": 0.5017654711020256,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2695821225643158,
      "eval_objectnav_pose_mae_dtheta": 0.03402848541736603,
      "eval_objectnav_pose_mae_dx": 0.01088081207126379,
      "eval_objectnav_pose_mae_dy": 0.004566348157823086,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2564043402671814,
      "eval_objectnav_pose_pose_mae_dx": 0.08461747318506241,
      "eval_objectnav_pose_pose_mae_dy": 0.04745060205459595,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45004144310951233,
      "eval_objectnav_pose_pose_rmse_dx": 0.19741755723953247,
      "eval_objectnav_pose_pose_rmse_dy": 0.11582253873348236,
      "eval_objectnav_pose_pose_rmse_mean": 0.2544271945953369,
      "eval_objectnav_pose_rmse_dtheta": 0.0515306182205677,
      "eval_objectnav_pose_rmse_dx": 0.02280806005001068,
      "eval_objectnav_pose_rmse_dy": 0.009632587432861328,
      "eval_objectnav_pose_rmse_mean": 0.027990421280264854,
      "eval_objectnav_pose_rotation_flip": 0.01523594930768013,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2695821225643158,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 10800
    },
    {
      "epoch": 0.5017654711020256,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08721363544464111,
      "eval_pointnav_mae_dtheta": 0.009939572773873806,
      "eval_pointnav_mae_dx": 0.002214271342381835,
      "eval_pointnav_mae_dy": 0.002284964080899954,
      "eval_pointnav_pose_mae_dtheta": 0.06725824624300003,
      "eval_pointnav_pose_mae_dx": 0.024441102519631386,
      "eval_pointnav_pose_mae_dy": 0.024471744894981384,
      "eval_pointnav_pose_rmse_dtheta": 0.19611410796642303,
      "eval_pointnav_pose_rmse_dx": 0.07663428783416748,
      "eval_pointnav_pose_rmse_dy": 0.07222907245159149,
      "eval_pointnav_pose_rmse_mean": 0.11499249935150146,
      "eval_pointnav_rmse_dtheta": 0.02495722286403179,
      "eval_pointnav_rmse_dx": 0.0072882468812167645,
      "eval_pointnav_rmse_dy": 0.006165031343698502,
      "eval_pointnav_rmse_mean": 0.012803500518202782,
      "eval_pointnav_rotation_flip": 0.004779093433171511,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08721363544464111,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 10800
    },
    {
      "epoch": 0.5017654711020256,
      "eval_loss": 0.22013497352600098,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.303609162569046,
      "eval_objectnav_nopose_mae_dtheta": 0.03929214924573898,
      "eval_objectnav_nopose_mae_dx": 0.01282401941716671,
      "eval_objectnav_nopose_mae_dy": 0.004972727969288826,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31518176198005676,
      "eval_objectnav_nopose_pose_mae_dx": 0.10218983143568039,
      "eval_objectnav_nopose_pose_mae_dy": 0.056076645851135254,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5329415798187256,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22719824314117432,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13279499113559723,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2976449429988861,
      "eval_objectnav_nopose_rmse_dtheta": 0.056963592767715454,
      "eval_objectnav_nopose_rmse_dx": 0.02537914365530014,
      "eval_objectnav_nopose_rmse_dy": 0.010163088329136372,
      "eval_objectnav_nopose_rmse_mean": 0.03083527646958828,
      "eval_objectnav_nopose_rotation_flip": 0.01584111526608467,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.303609162569046,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2695821225643158,
      "eval_objectnav_pose_mae_dtheta": 0.03402848541736603,
      "eval_objectnav_pose_mae_dx": 0.01088081207126379,
      "eval_objectnav_pose_mae_dy": 0.004566348157823086,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2564043402671814,
      "eval_objectnav_pose_pose_mae_dx": 0.08461747318506241,
      "eval_objectnav_pose_pose_mae_dy": 0.04745060205459595,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45004144310951233,
      "eval_objectnav_pose_pose_rmse_dx": 0.19741755723953247,
      "eval_objectnav_pose_pose_rmse_dy": 0.11582253873348236,
      "eval_objectnav_pose_pose_rmse_mean": 0.2544271945953369,
      "eval_objectnav_pose_rmse_dtheta": 0.0515306182205677,
      "eval_objectnav_pose_rmse_dx": 0.02280806005001068,
      "eval_objectnav_pose_rmse_dy": 0.009632587432861328,
      "eval_objectnav_pose_rmse_mean": 0.027990421280264854,
      "eval_objectnav_pose_rotation_flip": 0.01523594930768013,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2695821225643158,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08721363544464111,
      "eval_pointnav_mae_dtheta": 0.009939572773873806,
      "eval_pointnav_mae_dx": 0.002214271342381835,
      "eval_pointnav_mae_dy": 0.002284964080899954,
      "eval_pointnav_pose_mae_dtheta": 0.06725824624300003,
      "eval_pointnav_pose_mae_dx": 0.024441102519631386,
      "eval_pointnav_pose_mae_dy": 0.024471744894981384,
      "eval_pointnav_pose_rmse_dtheta": 0.19611410796642303,
      "eval_pointnav_pose_rmse_dx": 0.07663428783416748,
      "eval_pointnav_pose_rmse_dy": 0.07222907245159149,
      "eval_pointnav_pose_rmse_mean": 0.11499249935150146,
      "eval_pointnav_rmse_dtheta": 0.02495722286403179,
      "eval_pointnav_rmse_dx": 0.0072882468812167645,
      "eval_pointnav_rmse_dy": 0.006165031343698502,
      "eval_pointnav_rmse_mean": 0.012803500518202782,
      "eval_pointnav_rotation_flip": 0.004779093433171511,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08721363544464111,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 10800
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.5018119308678685,
      "grad_norm": 0.5175771713256836,
      "learning_rate": 2.4964441129527337e-07,
      "loss": 0.157,
      "mae_dtheta": 0.03973101079463959,
      "mae_dx": 0.007858747616410255,
      "mae_dy": 0.0032922509126365185,
      "pose_mae_dtheta": 0.31990471482276917,
      "pose_mae_dx": 0.06534633785486221,
      "pose_mae_dy": 0.030954819172620773,
      "pose_rmse_dtheta": 0.5470957159996033,
      "pose_rmse_dx": 0.14905773103237152,
      "pose_rmse_dy": 0.08590181916952133,
      "pose_rmse_mean": 0.2606850862503052,
      "rmse_dtheta": 0.05975846201181412,
      "rmse_dx": 0.017488284036517143,
      "rmse_dy": 0.008668326772749424,
      "rmse_mean": 0.028638359159231186,
      "rotation_flip": 0.02369980327785015,
      "sparse_tokens": 21637.0,
      "step": 10801,
      "turn_loss": 0.2636909782886505,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.5018583906337112,
      "grad_norm": 0.7103458642959595,
      "learning_rate": 2.4923200080634426e-07,
      "loss": 0.1821,
      "mae_dtheta": 0.036296822130680084,
      "mae_dx": 0.008643473498523235,
      "mae_dy": 0.007125220727175474,
      "pose_mae_dtheta": 0.299109548330307,
      "pose_mae_dx": 0.0706610232591629,
      "pose_mae_dy": 0.09980785101652145,
      "pose_rmse_dtheta": 0.5161510109901428,
      "pose_rmse_dx": 0.16522085666656494,
      "pose_rmse_dy": 0.18514001369476318,
      "pose_rmse_mean": 0.2888373136520386,
      "rmse_dtheta": 0.05413835495710373,
      "rmse_dx": 0.019645169377326965,
      "rmse_dy": 0.01144035067409277,
      "rmse_mean": 0.028407959267497063,
      "rotation_flip": 0.007075471803545952,
      "sparse_tokens": 7495.0,
      "step": 10802,
      "turn_loss": 0.30215325951576233,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.501904850399554,
      "grad_norm": 0.47047871351242065,
      "learning_rate": 2.4881992254117195e-07,
      "loss": 0.1178,
      "mae_dtheta": 0.03684568032622337,
      "mae_dx": 0.009128352627158165,
      "mae_dy": 0.004726611543446779,
      "pose_mae_dtheta": 0.2726081907749176,
      "pose_mae_dx": 0.06369544565677643,
      "pose_mae_dy": 0.04105667769908905,
      "pose_rmse_dtheta": 0.5077569484710693,
      "pose_rmse_dx": 0.14818792045116425,
      "pose_rmse_dy": 0.08876340836286545,
      "pose_rmse_mean": 0.24823610484600067,
      "rmse_dtheta": 0.05885989964008331,
      "rmse_dx": 0.019389184191823006,
      "rmse_dy": 0.010677612386643887,
      "rmse_mean": 0.02964223176240921,
      "rotation_flip": 0.0060606058686971664,
      "sparse_tokens": 10351.0,
      "step": 10803,
      "turn_loss": 0.2908053696155548,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.5019513101653967,
      "grad_norm": 0.6013590097427368,
      "learning_rate": 2.4840817652857173e-07,
      "loss": 0.1699,
      "mae_dtheta": 0.021066371351480484,
      "mae_dx": 0.006593102589249611,
      "mae_dy": 0.0039367456920444965,
      "pose_mae_dtheta": 0.16007480025291443,
      "pose_mae_dx": 0.05515237897634506,
      "pose_mae_dy": 0.055131927132606506,
      "pose_rmse_dtheta": 0.30380746722221375,
      "pose_rmse_dx": 0.14038249850273132,
      "pose_rmse_dy": 0.1462586522102356,
      "pose_rmse_mean": 0.19681620597839355,
      "rmse_dtheta": 0.03671405091881752,
      "rmse_dx": 0.016904138028621674,
      "rmse_dy": 0.00860519427806139,
      "rmse_mean": 0.02074112743139267,
      "rotation_flip": 0.00566572230309248,
      "sparse_tokens": 21144.0,
      "step": 10804,
      "turn_loss": 0.16918563842773438,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.5019977699312396,
      "grad_norm": 0.38029247522354126,
      "learning_rate": 2.4799676279733843e-07,
      "loss": 0.0975,
      "mae_dtheta": 0.030249321833252907,
      "mae_dx": 0.01237412728369236,
      "mae_dy": 0.0053235553205013275,
      "pose_mae_dtheta": 0.23597203195095062,
      "pose_mae_dx": 0.10150835663080215,
      "pose_mae_dy": 0.04445430263876915,
      "pose_rmse_dtheta": 0.4070483148097992,
      "pose_rmse_dx": 0.2206851691007614,
      "pose_rmse_dy": 0.11305641382932663,
      "pose_rmse_mean": 0.24692997336387634,
      "rmse_dtheta": 0.044799696654081345,
      "rmse_dx": 0.023939896374940872,
      "rmse_dy": 0.014019767753779888,
      "rmse_mean": 0.027586452662944794,
      "rotation_flip": 0.020123839378356934,
      "sparse_tokens": 11016.0,
      "step": 10805,
      "turn_loss": 0.2526494860649109,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 37523.0,
      "epoch": 0.5020442296970823,
      "grad_norm": 0.4310813844203949,
      "learning_rate": 2.475856813762417e-07,
      "loss": 0.1067,
      "mae_dtheta": 0.03326572850346565,
      "mae_dx": 0.012268606573343277,
      "mae_dy": 0.004324725829064846,
      "pose_mae_dtheta": 0.27080148458480835,
      "pose_mae_dx": 0.09181971848011017,
      "pose_mae_dy": 0.04990131035447121,
      "pose_rmse_dtheta": 0.4747277796268463,
      "pose_rmse_dx": 0.20206491649150848,
      "pose_rmse_dy": 0.11750300973653793,
      "pose_rmse_mean": 0.2647652328014374,
      "rmse_dtheta": 0.050843849778175354,
      "rmse_dx": 0.02396375499665737,
      "rmse_dy": 0.008340539410710335,
      "rmse_mean": 0.027716048061847687,
      "rotation_flip": 0.012907191179692745,
      "sparse_tokens": 28805.0,
      "step": 10806,
      "turn_loss": 0.27231523394584656,
      "turns": 116.0,
      "turns_per_sample": 116.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.5020906894629251,
      "grad_norm": 0.47350841760635376,
      "learning_rate": 2.4717493229402976e-07,
      "loss": 0.0984,
      "mae_dtheta": 0.026958918198943138,
      "mae_dx": 0.011116626672446728,
      "mae_dy": 0.005594240501523018,
      "pose_mae_dtheta": 0.20800474286079407,
      "pose_mae_dx": 0.09125835448503494,
      "pose_mae_dy": 0.06801087409257889,
      "pose_rmse_dtheta": 0.3211078941822052,
      "pose_rmse_dx": 0.21807990968227386,
      "pose_rmse_dy": 0.1617620289325714,
      "pose_rmse_mean": 0.23364993929862976,
      "rmse_dtheta": 0.043297216296195984,
      "rmse_dx": 0.02466789446771145,
      "rmse_dy": 0.009630772285163403,
      "rmse_mean": 0.02586529403924942,
      "rotation_flip": 0.013468013145029545,
      "sparse_tokens": 4822.0,
      "step": 10807,
      "turn_loss": 0.22276468575000763,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5021371492287678,
      "grad_norm": 0.48476824164390564,
      "learning_rate": 2.4676451557942516e-07,
      "loss": 0.1378,
      "mae_dtheta": 0.009049535728991032,
      "mae_dx": 0.0015970562817528844,
      "mae_dy": 0.0025357946287840605,
      "pose_mae_dtheta": 0.06022300943732262,
      "pose_mae_dx": 0.022673510015010834,
      "pose_mae_dy": 0.02538423053920269,
      "pose_rmse_dtheta": 0.1532602608203888,
      "pose_rmse_dx": 0.07548080384731293,
      "pose_rmse_dy": 0.06264884024858475,
      "pose_rmse_mean": 0.09712997078895569,
      "rmse_dtheta": 0.02037101611495018,
      "rmse_dx": 0.005305565427988768,
      "rmse_dy": 0.005988527555018663,
      "rmse_mean": 0.01055503636598587,
      "rotation_flip": 0.002978723496198654,
      "sparse_tokens": 32089.0,
      "step": 10808,
      "turn_loss": 0.07849495112895966,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.5021836089946107,
      "grad_norm": 0.5561188459396362,
      "learning_rate": 2.463544312611299e-07,
      "loss": 0.1305,
      "mae_dtheta": 0.04049934819340706,
      "mae_dx": 0.01677328161895275,
      "mae_dy": 0.0057462588883936405,
      "pose_mae_dtheta": 0.3402339518070221,
      "pose_mae_dx": 0.11989077180624008,
      "pose_mae_dy": 0.07942450046539307,
      "pose_rmse_dtheta": 0.5103753805160522,
      "pose_rmse_dx": 0.23739710450172424,
      "pose_rmse_dy": 0.18256469070911407,
      "pose_rmse_mean": 0.3101123869419098,
      "rmse_dtheta": 0.05475249141454697,
      "rmse_dx": 0.029981669038534164,
      "rmse_dy": 0.010708841495215893,
      "rmse_mean": 0.0318143330514431,
      "rotation_flip": 0.01983002759516239,
      "sparse_tokens": 10449.0,
      "step": 10809,
      "turn_loss": 0.33203399181365967,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5022300687604534,
      "grad_norm": 0.3757900297641754,
      "learning_rate": 2.4594467936781995e-07,
      "loss": 0.0787,
      "mae_dtheta": 0.0063333106227219105,
      "mae_dx": 0.0008492855704389513,
      "mae_dy": 0.0009921492310240865,
      "pose_mae_dtheta": 0.040215425193309784,
      "pose_mae_dx": 0.008062578737735748,
      "pose_mae_dy": 0.01421297900378704,
      "pose_rmse_dtheta": 0.10832707583904266,
      "pose_rmse_dx": 0.01995225064456463,
      "pose_rmse_dy": 0.03143951669335365,
      "pose_rmse_mean": 0.0532396137714386,
      "rmse_dtheta": 0.016936656087636948,
      "rmse_dx": 0.0027318266220390797,
      "rmse_dy": 0.0019869795069098473,
      "rmse_mean": 0.007218487560749054,
      "rotation_flip": 0.0012453299714252353,
      "sparse_tokens": 32137.0,
      "step": 10810,
      "turn_loss": 0.04903450235724449,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.5022765285262962,
      "grad_norm": 0.6468134522438049,
      "learning_rate": 2.455352599281502e-07,
      "loss": 0.1451,
      "mae_dtheta": 0.04910782724618912,
      "mae_dx": 0.01507282629609108,
      "mae_dy": 0.006032365374267101,
      "pose_mae_dtheta": 0.4413160979747772,
      "pose_mae_dx": 0.10340079665184021,
      "pose_mae_dy": 0.07716646045446396,
      "pose_rmse_dtheta": 0.6608015298843384,
      "pose_rmse_dx": 0.21954986453056335,
      "pose_rmse_dy": 0.1517980843782425,
      "pose_rmse_mean": 0.344049870967865,
      "rmse_dtheta": 0.06517639756202698,
      "rmse_dx": 0.02825920842587948,
      "rmse_dy": 0.010473799891769886,
      "rmse_mean": 0.034636471420526505,
      "rotation_flip": 0.014563106931746006,
      "sparse_tokens": 3314.0,
      "step": 10811,
      "turn_loss": 0.2798878848552704,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.5023229882921391,
      "grad_norm": 0.47090303897857666,
      "learning_rate": 2.451261729707521e-07,
      "loss": 0.1116,
      "mae_dtheta": 0.023416591808199883,
      "mae_dx": 0.007396946661174297,
      "mae_dy": 0.0033095339313149452,
      "pose_mae_dtheta": 0.16292858123779297,
      "pose_mae_dx": 0.06242954358458519,
      "pose_mae_dy": 0.044106241315603256,
      "pose_rmse_dtheta": 0.3715030550956726,
      "pose_rmse_dx": 0.15950500965118408,
      "pose_rmse_dy": 0.08650923520326614,
      "pose_rmse_mean": 0.2058390974998474,
      "rmse_dtheta": 0.04154783487319946,
      "rmse_dx": 0.018040629103779793,
      "rmse_dy": 0.006105554755777121,
      "rmse_mean": 0.02189800702035427,
      "rotation_flip": 0.008431702852249146,
      "sparse_tokens": 10847.0,
      "step": 10812,
      "turn_loss": 0.1768854707479477,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.5023694480579818,
      "grad_norm": 0.6293301582336426,
      "learning_rate": 2.447174185242324e-07,
      "loss": 0.1435,
      "mae_dtheta": 0.019492369145154953,
      "mae_dx": 0.01127739530056715,
      "mae_dy": 0.004357054363936186,
      "pose_mae_dtheta": 0.15902318060398102,
      "pose_mae_dx": 0.09579567611217499,
      "pose_mae_dy": 0.09127172827720642,
      "pose_rmse_dtheta": 0.2957727611064911,
      "pose_rmse_dx": 0.24839119613170624,
      "pose_rmse_dy": 0.19012393057346344,
      "pose_rmse_mean": 0.2447626292705536,
      "rmse_dtheta": 0.03445884585380554,
      "rmse_dx": 0.027044693008065224,
      "rmse_dy": 0.007971096783876419,
      "rmse_mean": 0.02315821312367916,
      "rotation_flip": 0.008849557489156723,
      "sparse_tokens": 9239.0,
      "step": 10813,
      "turn_loss": 0.17788942158222198,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.5024159078238246,
      "grad_norm": 0.5975855588912964,
      "learning_rate": 2.443089966171763e-07,
      "loss": 0.1215,
      "mae_dtheta": 0.020956598222255707,
      "mae_dx": 0.010029071010649204,
      "mae_dy": 0.00450722873210907,
      "pose_mae_dtheta": 0.18295904994010925,
      "pose_mae_dx": 0.07966268807649612,
      "pose_mae_dy": 0.02625090442597866,
      "pose_rmse_dtheta": 0.3132752776145935,
      "pose_rmse_dx": 0.1787254810333252,
      "pose_rmse_dy": 0.049177832901477814,
      "pose_rmse_mean": 0.18039286136627197,
      "rmse_dtheta": 0.0344497375190258,
      "rmse_dx": 0.0207014512270689,
      "rmse_dy": 0.009535543620586395,
      "rmse_mean": 0.02156224474310875,
      "rotation_flip": 0.007575757801532745,
      "sparse_tokens": 3066.0,
      "step": 10814,
      "turn_loss": 0.21585509181022644,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.5024623675896673,
      "grad_norm": 0.6394315361976624,
      "learning_rate": 2.439009072781445e-07,
      "loss": 0.1897,
      "mae_dtheta": 0.03331640735268593,
      "mae_dx": 0.007935754954814911,
      "mae_dy": 0.006350180599838495,
      "pose_mae_dtheta": 0.24426023662090302,
      "pose_mae_dx": 0.07522935420274734,
      "pose_mae_dy": 0.07587902247905731,
      "pose_rmse_dtheta": 0.4369564652442932,
      "pose_rmse_dx": 0.17128632962703705,
      "pose_rmse_dy": 0.14677360653877258,
      "pose_rmse_mean": 0.2516721487045288,
      "rmse_dtheta": 0.04997241869568825,
      "rmse_dx": 0.018547335639595985,
      "rmse_dy": 0.011382942087948322,
      "rmse_mean": 0.026634234935045242,
      "rotation_flip": 0.016815034672617912,
      "sparse_tokens": 17899.0,
      "step": 10815,
      "turn_loss": 0.26958775520324707,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 33413.0,
      "epoch": 0.5025088273555102,
      "grad_norm": 0.5414999127388,
      "learning_rate": 2.4349315053567466e-07,
      "loss": 0.1583,
      "mae_dtheta": 0.0340392030775547,
      "mae_dx": 0.009563477709889412,
      "mae_dy": 0.006007360760122538,
      "pose_mae_dtheta": 0.2561380863189697,
      "pose_mae_dx": 0.07759379595518112,
      "pose_mae_dy": 0.05865240842103958,
      "pose_rmse_dtheta": 0.48400214314460754,
      "pose_rmse_dx": 0.16957086324691772,
      "pose_rmse_dy": 0.14680083096027374,
      "pose_rmse_mean": 0.26679128408432007,
      "rmse_dtheta": 0.054680950939655304,
      "rmse_dx": 0.020258059725165367,
      "rmse_dy": 0.012392619624733925,
      "rmse_mean": 0.029110543429851532,
      "rotation_flip": 0.016005121171474457,
      "sparse_tokens": 26983.0,
      "step": 10816,
      "turn_loss": 0.25852376222610474,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5025552871213529,
      "grad_norm": 0.47318509221076965,
      "learning_rate": 2.4308572641828234e-07,
      "loss": 0.0988,
      "mae_dtheta": 0.0090117696672678,
      "mae_dx": 0.0010811449028551579,
      "mae_dy": 0.001788655063137412,
      "pose_mae_dtheta": 0.054030489176511765,
      "pose_mae_dx": 0.014907642267644405,
      "pose_mae_dy": 0.022183962166309357,
      "pose_rmse_dtheta": 0.13057513535022736,
      "pose_rmse_dx": 0.04105366766452789,
      "pose_rmse_dy": 0.05073009058833122,
      "pose_rmse_mean": 0.07411963492631912,
      "rmse_dtheta": 0.019514767453074455,
      "rmse_dx": 0.003078518668189645,
      "rmse_dy": 0.004054878372699022,
      "rmse_mean": 0.00888272188603878,
      "rotation_flip": 0.0037216225173324347,
      "sparse_tokens": 32105.0,
      "step": 10817,
      "turn_loss": 0.06777552515268326,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.5026017468871957,
      "grad_norm": 0.794821560382843,
      "learning_rate": 2.42678634954458e-07,
      "loss": 0.1331,
      "mae_dtheta": 0.03562956675887108,
      "mae_dx": 0.008172626607120037,
      "mae_dy": 0.003856674302369356,
      "pose_mae_dtheta": 0.25341206789016724,
      "pose_mae_dx": 0.05970248952507973,
      "pose_mae_dy": 0.047145869582891464,
      "pose_rmse_dtheta": 0.4154757857322693,
      "pose_rmse_dx": 0.11977207660675049,
      "pose_rmse_dy": 0.10435163229703903,
      "pose_rmse_mean": 0.21319983899593353,
      "rmse_dtheta": 0.05065919831395149,
      "rmse_dx": 0.01635798253118992,
      "rmse_dy": 0.007914558053016663,
      "rmse_mean": 0.024977248162031174,
      "rotation_flip": 0.010178117081522942,
      "sparse_tokens": 6397.0,
      "step": 10818,
      "turn_loss": 0.2312147319316864,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5026482066530384,
      "grad_norm": 0.6695272326469421,
      "learning_rate": 2.4227187617267057e-07,
      "loss": 0.1138,
      "mae_dtheta": 0.008477526716887951,
      "mae_dx": 0.0030206560622900724,
      "mae_dy": 0.001993166981264949,
      "pose_mae_dtheta": 0.06006544828414917,
      "pose_mae_dx": 0.0323810875415802,
      "pose_mae_dy": 0.02378872036933899,
      "pose_rmse_dtheta": 0.17319029569625854,
      "pose_rmse_dx": 0.10605368763208389,
      "pose_rmse_dy": 0.06440550088882446,
      "pose_rmse_mean": 0.11454983055591583,
      "rmse_dtheta": 0.021256839856505394,
      "rmse_dx": 0.010534138418734074,
      "rmse_dy": 0.005475352983921766,
      "rmse_mean": 0.012422110885381699,
      "rotation_flip": 0.0019772613886743784,
      "sparse_tokens": 32089.0,
      "step": 10819,
      "turn_loss": 0.10312464088201523,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5026946664188813,
      "grad_norm": 0.5738317966461182,
      "learning_rate": 2.4186545010136395e-07,
      "loss": 0.1105,
      "mae_dtheta": 0.006090601906180382,
      "mae_dx": 0.0009887239430099726,
      "mae_dy": 0.0014012337196618319,
      "pose_mae_dtheta": 0.03693005070090294,
      "pose_mae_dx": 0.013202319853007793,
      "pose_mae_dy": 0.01790950633585453,
      "pose_rmse_dtheta": 0.06401300430297852,
      "pose_rmse_dx": 0.032352104783058167,
      "pose_rmse_dy": 0.03773529455065727,
      "pose_rmse_mean": 0.04470013827085495,
      "rmse_dtheta": 0.011964336968958378,
      "rmse_dx": 0.0031847283244132996,
      "rmse_dy": 0.0028152160812169313,
      "rmse_mean": 0.00598809402436018,
      "rotation_flip": 0.002020202111452818,
      "sparse_tokens": 32073.0,
      "step": 10820,
      "turn_loss": 0.05339198186993599,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.502741126184724,
      "grad_norm": 0.5876775979995728,
      "learning_rate": 2.4145935676896106e-07,
      "loss": 0.1404,
      "mae_dtheta": 0.025578361004590988,
      "mae_dx": 0.009541856124997139,
      "mae_dy": 0.004368863068521023,
      "pose_mae_dtheta": 0.18044233322143555,
      "pose_mae_dx": 0.07763264328241348,
      "pose_mae_dy": 0.03811695799231529,
      "pose_rmse_dtheta": 0.343425989151001,
      "pose_rmse_dx": 0.1891944855451584,
      "pose_rmse_dy": 0.0784088522195816,
      "pose_rmse_mean": 0.20367644727230072,
      "rmse_dtheta": 0.04014746472239494,
      "rmse_dx": 0.022045068442821503,
      "rmse_dy": 0.007558461744338274,
      "rmse_mean": 0.023250332102179527,
      "rotation_flip": 0.0,
      "sparse_tokens": 5856.0,
      "step": 10821,
      "turn_loss": 0.3055360019207001,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 3603.0,
      "epoch": 0.5027875859505668,
      "grad_norm": 0.5121654868125916,
      "learning_rate": 2.4105359620385846e-07,
      "loss": 0.097,
      "mae_dtheta": 0.017423667013645172,
      "mae_dx": 0.013962334021925926,
      "mae_dy": 0.002582777524366975,
      "pose_mae_dtheta": 0.10837668180465698,
      "pose_mae_dx": 0.0888487696647644,
      "pose_mae_dy": 0.024214336648583412,
      "pose_rmse_dtheta": 0.191365584731102,
      "pose_rmse_dx": 0.20709390938282013,
      "pose_rmse_dy": 0.06542034447193146,
      "pose_rmse_mean": 0.15462660789489746,
      "rmse_dtheta": 0.027662627398967743,
      "rmse_dx": 0.02732274867594242,
      "rmse_dy": 0.004962945356965065,
      "rmse_mean": 0.019982773810625076,
      "rotation_flip": 0.0,
      "sparse_tokens": 2643.0,
      "step": 10822,
      "turn_loss": 0.2449449896812439,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.5028340457164096,
      "grad_norm": 0.7965015172958374,
      "learning_rate": 2.40648168434432e-07,
      "loss": 0.2178,
      "mae_dtheta": 0.030133144930005074,
      "mae_dx": 0.009198823943734169,
      "mae_dy": 0.0034801745787262917,
      "pose_mae_dtheta": 0.2545410096645355,
      "pose_mae_dx": 0.07084096223115921,
      "pose_mae_dy": 0.042416106909513474,
      "pose_rmse_dtheta": 0.47422924637794495,
      "pose_rmse_dx": 0.15777616202831268,
      "pose_rmse_dy": 0.0871354341506958,
      "pose_rmse_mean": 0.2397136092185974,
      "rmse_dtheta": 0.0477435477077961,
      "rmse_dx": 0.018557261675596237,
      "rmse_dy": 0.007257496938109398,
      "rmse_mean": 0.024519436061382294,
      "rotation_flip": 0.009960159659385681,
      "sparse_tokens": 8266.0,
      "step": 10823,
      "turn_loss": 0.20499001443386078,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5028805054822524,
      "grad_norm": 0.46254900097846985,
      "learning_rate": 2.4024307348903433e-07,
      "loss": 0.1187,
      "mae_dtheta": 0.009331263601779938,
      "mae_dx": 0.0014027856523171067,
      "mae_dy": 0.0020420351065695286,
      "pose_mae_dtheta": 0.06397426128387451,
      "pose_mae_dx": 0.015476973727345467,
      "pose_mae_dy": 0.02241882123053074,
      "pose_rmse_dtheta": 0.1569981575012207,
      "pose_rmse_dx": 0.04176655784249306,
      "pose_rmse_dy": 0.0595909059047699,
      "pose_rmse_mean": 0.08611854165792465,
      "rmse_dtheta": 0.02105564996600151,
      "rmse_dx": 0.0045691849663853645,
      "rmse_dy": 0.0055548339150846004,
      "rmse_mean": 0.01039322279393673,
      "rotation_flip": 0.0033585221972316504,
      "sparse_tokens": 32105.0,
      "step": 10824,
      "turn_loss": 0.08244767785072327,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5029269652480951,
      "grad_norm": 0.5160008072853088,
      "learning_rate": 2.398383113959929e-07,
      "loss": 0.0942,
      "mae_dtheta": 0.007603039965033531,
      "mae_dx": 0.0013051526620984077,
      "mae_dy": 0.0016330764628946781,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5160006880760193,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 163.71316528320312,
      "model/head/act_norm_mean": 118.49877683080808,
      "model/head/act_norm_min": 56.08307647705078,
      "model/head/act_over_embed": 81.43346884115894,
      "model/head/grad_frac": 0.09530115872621536,
      "model/head/grad_norm": 0.04917546361684799,
      "model/head/grad_zero_frac": 0.00014626228949055076,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7047378077651515,
      "model/head/update_ratio": 0.0008371158037334681,
      "model/head/weight_delta": 9.978439331054688,
      "model/head/weight_delta_rel": 0.17505137622356415,
      "model/head/weight_norm": 58.743919372558594,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229358732700348,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42285939902741443,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227961599826813,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059293788370594,
      "model/modality_embedder.encoders.pose/grad_frac": 0.15903015434741974,
      "model/modality_embedder.encoders.pose/grad_norm": 0.08205966651439667,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5310025452488688,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0026496571954339743,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1556994915008545,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1031065359711647,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96991729736328,
      "model/modality_embedder/grad_frac": 0.15903015434741974,
      "model/modality_embedder/grad_norm": 0.08205966651439667,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5310025452488688,
      "model/modality_embedder/update_ratio": 0.0026496571954339743,
      "model/modality_embedder/weight_delta": 3.1556994915008545,
      "model/modality_embedder/weight_delta_rel": 0.1031065359711647,
      "model/modality_embedder/weight_norm": 30.96991729736328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.48762512207031,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.430490420073752,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.915473937988281,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.788861738529565,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.048942871391773224,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02525455504655838,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009032253874465823,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7387325763702393,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09980107098817825,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960412979125977,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.79158782958984,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.414379409171076,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.18025016784668,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.46499946315109,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05218924209475517,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.026929683983325958,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009046113700605929,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.472189426422119,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12027935683727264,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76934051513672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.53060913085938,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.24203593474427,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.219528198242188,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.720982138314966,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05528463050723076,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02852690778672695,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009279796504415572,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.761591911315918,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12630721926689148,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.740877151489258,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.97248840332031,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.915584415584416,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.08543872833252,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.871060322356048,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06482469290494919,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03344958648085594,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011166793992742896,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2331318855285645,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11049310117959976,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954511642456055,
      "model/normalizer/grad_frac": 0.20135456323623657,
      "model/normalizer/grad_norm": 0.10389909148216248,
      "model/normalizer/grad_zero_frac": 0.00023398420307785273,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0013209229800850153,
      "model/normalizer/weight_delta": 6.7998881340026855,
      "model/normalizer/weight_delta_rel": 0.08757862448692322,
      "model/normalizer/weight_norm": 78.65643310546875,
      "pose_mae_dtheta": 0.04876774549484253,
      "pose_mae_dx": 0.012845897115767002,
      "pose_mae_dy": 0.017913594841957092,
      "pose_rmse_dtheta": 0.13705740869045258,
      "pose_rmse_dx": 0.040950626134872437,
      "pose_rmse_dy": 0.05233822390437126,
      "pose_rmse_mean": 0.07678209245204926,
      "rmse_dtheta": 0.019482580944895744,
      "rmse_dx": 0.004229402169585228,
      "rmse_dy": 0.0045710341073572636,
      "rmse_mean": 0.009427672252058983,
      "rotation_flip": 0.005109861958771944,
      "sparse_tokens": 32089.0,
      "step": 10825,
      "turn_loss": 0.06636956334114075,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5029734250139379,
      "grad_norm": 0.791239857673645,
      "learning_rate": 2.3943388218361395e-07,
      "loss": 0.1183,
      "mae_dtheta": 0.008786209858953953,
      "mae_dx": 0.0017878717044368386,
      "mae_dy": 0.002425865037366748,
      "pose_mae_dtheta": 0.06068319082260132,
      "pose_mae_dx": 0.02446991205215454,
      "pose_mae_dy": 0.027287153527140617,
      "pose_rmse_dtheta": 0.1596001386642456,
      "pose_rmse_dx": 0.06762677431106567,
      "pose_rmse_dy": 0.06777943670749664,
      "pose_rmse_mean": 0.09833544492721558,
      "rmse_dtheta": 0.021049875766038895,
      "rmse_dx": 0.004965806845575571,
      "rmse_dy": 0.005317447707056999,
      "rmse_mean": 0.01044437661767006,
      "rotation_flip": 0.0035785287618637085,
      "sparse_tokens": 32073.0,
      "step": 10826,
      "turn_loss": 0.06966997683048248,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.5030198847797807,
      "grad_norm": 0.5116514563560486,
      "learning_rate": 2.390297858801782e-07,
      "loss": 0.1387,
      "mae_dtheta": 0.04333493486046791,
      "mae_dx": 0.00867282785475254,
      "mae_dy": 0.006282401271164417,
      "pose_mae_dtheta": 0.40444380044937134,
      "pose_mae_dx": 0.06910515576601028,
      "pose_mae_dy": 0.05777431279420853,
      "pose_rmse_dtheta": 0.6314553022384644,
      "pose_rmse_dx": 0.14114239811897278,
      "pose_rmse_dy": 0.11956539005041122,
      "pose_rmse_mean": 0.2973876893520355,
      "rmse_dtheta": 0.06437383592128754,
      "rmse_dx": 0.018040480092167854,
      "rmse_dy": 0.013375353068113327,
      "rmse_mean": 0.03192989155650139,
      "rotation_flip": 0.013793103396892548,
      "sparse_tokens": 4712.0,
      "step": 10827,
      "turn_loss": 0.4350196123123169,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5030663445456235,
      "grad_norm": 0.5324881672859192,
      "learning_rate": 2.3862602251394527e-07,
      "loss": 0.1161,
      "mae_dtheta": 0.010166614316403866,
      "mae_dx": 0.001732832519337535,
      "mae_dy": 0.002753620967268944,
      "pose_mae_dtheta": 0.06894652545452118,
      "pose_mae_dx": 0.024485446512699127,
      "pose_mae_dy": 0.029429778456687927,
      "pose_rmse_dtheta": 0.15221838653087616,
      "pose_rmse_dx": 0.065670445561409,
      "pose_rmse_dy": 0.06747552752494812,
      "pose_rmse_mean": 0.09512145817279816,
      "rmse_dtheta": 0.021632682532072067,
      "rmse_dx": 0.005082090385258198,
      "rmse_dy": 0.006032323930412531,
      "rmse_mean": 0.010915699414908886,
      "rotation_flip": 0.0034722222480922937,
      "sparse_tokens": 32073.0,
      "step": 10828,
      "turn_loss": 0.09303153306245804,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5031128043114663,
      "grad_norm": 0.4223387539386749,
      "learning_rate": 2.382225921131498e-07,
      "loss": 0.1063,
      "mae_dtheta": 0.009840571321547031,
      "mae_dx": 0.00116445729508996,
      "mae_dy": 0.0024336513597518206,
      "pose_mae_dtheta": 0.05899917334318161,
      "pose_mae_dx": 0.020760158076882362,
      "pose_mae_dy": 0.028742600232362747,
      "pose_rmse_dtheta": 0.13189813494682312,
      "pose_rmse_dx": 0.05916590616106987,
      "pose_rmse_dy": 0.06473442912101746,
      "pose_rmse_mean": 0.08526615798473358,
      "rmse_dtheta": 0.01957300864160061,
      "rmse_dx": 0.003550131805241108,
      "rmse_dy": 0.005266515072435141,
      "rmse_mean": 0.009463218972086906,
      "rotation_flip": 0.002871500328183174,
      "sparse_tokens": 32057.0,
      "step": 10829,
      "turn_loss": 0.08051575720310211,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.503159264077309,
      "grad_norm": 0.46679213643074036,
      "learning_rate": 2.3781949470600364e-07,
      "loss": 0.1076,
      "mae_dtheta": 0.03524412587285042,
      "mae_dx": 0.013275367207825184,
      "mae_dy": 0.008868208155035973,
      "pose_mae_dtheta": 0.2626524567604065,
      "pose_mae_dx": 0.12326515465974808,
      "pose_mae_dy": 0.07893926650285721,
      "pose_rmse_dtheta": 0.4617764353752136,
      "pose_rmse_dx": 0.25567933917045593,
      "pose_rmse_dy": 0.15095852315425873,
      "pose_rmse_mean": 0.28947144746780396,
      "rmse_dtheta": 0.05201830342411995,
      "rmse_dx": 0.025211039930582047,
      "rmse_dy": 0.018092205747961998,
      "rmse_mean": 0.031773850321769714,
      "rotation_flip": 0.015329125337302685,
      "sparse_tokens": 17956.0,
      "step": 10830,
      "turn_loss": 0.3540612757205963,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5032057238431519,
      "grad_norm": 0.3542628884315491,
      "learning_rate": 2.3741673032069757e-07,
      "loss": 0.0971,
      "mae_dtheta": 0.007052149623632431,
      "mae_dx": 0.0023118765093386173,
      "mae_dy": 0.001109856995753944,
      "pose_mae_dtheta": 0.04745476320385933,
      "pose_mae_dx": 0.023265603929758072,
      "pose_mae_dy": 0.014369852840900421,
      "pose_rmse_dtheta": 0.17200934886932373,
      "pose_rmse_dx": 0.08158913254737854,
      "pose_rmse_dy": 0.048868827521800995,
      "pose_rmse_mean": 0.10082244127988815,
      "rmse_dtheta": 0.02256825752556324,
      "rmse_dx": 0.008299579843878746,
      "rmse_dy": 0.003501068102195859,
      "rmse_mean": 0.011456302367150784,
      "rotation_flip": 0.007823613472282887,
      "sparse_tokens": 32089.0,
      "step": 10831,
      "turn_loss": 0.07343751192092896,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.5032521836089946,
      "grad_norm": 0.5273919701576233,
      "learning_rate": 2.3701429898539517e-07,
      "loss": 0.0818,
      "mae_dtheta": 0.032108407467603683,
      "mae_dx": 0.010959213599562645,
      "mae_dy": 0.00448501855134964,
      "pose_mae_dtheta": 0.2406509518623352,
      "pose_mae_dx": 0.09518134593963623,
      "pose_mae_dy": 0.052863117307424545,
      "pose_rmse_dtheta": 0.44556984305381775,
      "pose_rmse_dx": 0.22734318673610687,
      "pose_rmse_dy": 0.16017790138721466,
      "pose_rmse_mean": 0.27769696712493896,
      "rmse_dtheta": 0.051241692155599594,
      "rmse_dx": 0.023814555257558823,
      "rmse_dy": 0.012081818655133247,
      "rmse_mean": 0.02904602140188217,
      "rotation_flip": 0.007352941203862429,
      "sparse_tokens": 15141.0,
      "step": 10832,
      "turn_loss": 0.26916277408599854,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.5032986433748374,
      "grad_norm": 0.45815491676330566,
      "learning_rate": 2.3661220072823953e-07,
      "loss": 0.0911,
      "mae_dtheta": 0.04450422525405884,
      "mae_dx": 0.0117874126881361,
      "mae_dy": 0.004843462724238634,
      "pose_mae_dtheta": 0.39788565039634705,
      "pose_mae_dx": 0.09450671821832657,
      "pose_mae_dy": 0.07067056745290756,
      "pose_rmse_dtheta": 0.7222112417221069,
      "pose_rmse_dx": 0.21128861606121063,
      "pose_rmse_dy": 0.1547573208808899,
      "pose_rmse_mean": 0.36275240778923035,
      "rmse_dtheta": 0.06701701879501343,
      "rmse_dx": 0.023532109335064888,
      "rmse_dy": 0.008428416214883327,
      "rmse_mean": 0.032992515712976456,
      "rotation_flip": 0.009966777637600899,
      "sparse_tokens": 5923.0,
      "step": 10833,
      "turn_loss": 0.3390355110168457,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.5033451031406802,
      "grad_norm": 0.6784201264381409,
      "learning_rate": 2.3621043557734868e-07,
      "loss": 0.2174,
      "mae_dtheta": 0.033748406916856766,
      "mae_dx": 0.015999650582671165,
      "mae_dy": 0.006743459962308407,
      "pose_mae_dtheta": 0.25863638520240784,
      "pose_mae_dx": 0.1226339265704155,
      "pose_mae_dy": 0.07362845540046692,
      "pose_rmse_dtheta": 0.492780476808548,
      "pose_rmse_dx": 0.2506953775882721,
      "pose_rmse_dy": 0.15945881605148315,
      "pose_rmse_mean": 0.30097824335098267,
      "rmse_dtheta": 0.05248037725687027,
      "rmse_dx": 0.02845403179526329,
      "rmse_dy": 0.012776012532413006,
      "rmse_mean": 0.031236805021762848,
      "rotation_flip": 0.01440576184540987,
      "sparse_tokens": 14358.0,
      "step": 10834,
      "turn_loss": 0.31985989212989807,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.503391562906523,
      "grad_norm": 0.6569732427597046,
      "learning_rate": 2.3580900356081903e-07,
      "loss": 0.1089,
      "mae_dtheta": 0.0073359087109565735,
      "mae_dx": 0.0016147984424605966,
      "mae_dy": 0.0013981229858472943,
      "pose_mae_dtheta": 0.052382588386535645,
      "pose_mae_dx": 0.018089814111590385,
      "pose_mae_dy": 0.01745431497693062,
      "pose_rmse_dtheta": 0.1583067625761032,
      "pose_rmse_dx": 0.057432230561971664,
      "pose_rmse_dy": 0.04293932020664215,
      "pose_rmse_mean": 0.08622610569000244,
      "rmse_dtheta": 0.01875523291528225,
      "rmse_dx": 0.005957089364528656,
      "rmse_dy": 0.003327895887196064,
      "rmse_mean": 0.009346740320324898,
      "rotation_flip": 0.005575266201049089,
      "sparse_tokens": 32089.0,
      "step": 10835,
      "turn_loss": 0.056510403752326965,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.5034380226723657,
      "grad_norm": 0.7601746916770935,
      "learning_rate": 2.354079047067237e-07,
      "loss": 0.1976,
      "mae_dtheta": 0.03062255121767521,
      "mae_dx": 0.007624417543411255,
      "mae_dy": 0.003932141233235598,
      "pose_mae_dtheta": 0.23260745406150818,
      "pose_mae_dx": 0.0601503886282444,
      "pose_mae_dy": 0.04052349179983139,
      "pose_rmse_dtheta": 0.4377354383468628,
      "pose_rmse_dx": 0.1461978405714035,
      "pose_rmse_dy": 0.10794634371995926,
      "pose_rmse_mean": 0.23062655329704285,
      "rmse_dtheta": 0.049633122980594635,
      "rmse_dx": 0.0179011058062315,
      "rmse_dy": 0.00808238610625267,
      "rmse_mean": 0.025205537676811218,
      "rotation_flip": 0.012987012974917889,
      "sparse_tokens": 14224.0,
      "step": 10836,
      "turn_loss": 0.21373048424720764,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.5034844824382085,
      "grad_norm": 0.359557181596756,
      "learning_rate": 2.3500713904311023e-07,
      "loss": 0.1136,
      "mae_dtheta": 0.019866619259119034,
      "mae_dx": 0.005661708768457174,
      "mae_dy": 0.0030166422948241234,
      "pose_mae_dtheta": 0.13583272695541382,
      "pose_mae_dx": 0.049932993948459625,
      "pose_mae_dy": 0.03728567063808441,
      "pose_rmse_dtheta": 0.29004862904548645,
      "pose_rmse_dx": 0.14934659004211426,
      "pose_rmse_dy": 0.09286779910326004,
      "pose_rmse_mean": 0.17742101848125458,
      "rmse_dtheta": 0.03587200120091438,
      "rmse_dx": 0.015813909471035004,
      "rmse_dy": 0.0063583338633179665,
      "rmse_mean": 0.019348081201314926,
      "rotation_flip": 0.004580152686685324,
      "sparse_tokens": 14899.0,
      "step": 10837,
      "turn_loss": 0.1585700511932373,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5035309422040513,
      "grad_norm": 0.5797122716903687,
      "learning_rate": 2.3460670659800565e-07,
      "loss": 0.1293,
      "mae_dtheta": 0.006585123483091593,
      "mae_dx": 0.000985248596407473,
      "mae_dy": 0.0014199069701135159,
      "pose_mae_dtheta": 0.03842941299080849,
      "pose_mae_dx": 0.013162858784198761,
      "pose_mae_dy": 0.01723724976181984,
      "pose_rmse_dtheta": 0.08711927384138107,
      "pose_rmse_dx": 0.036737751215696335,
      "pose_rmse_dy": 0.04547702521085739,
      "pose_rmse_mean": 0.0564446859061718,
      "rmse_dtheta": 0.01568016968667507,
      "rmse_dx": 0.003030991880223155,
      "rmse_dy": 0.0033496138639748096,
      "rmse_mean": 0.007353591732680798,
      "rotation_flip": 0.006864988710731268,
      "sparse_tokens": 32073.0,
      "step": 10838,
      "turn_loss": 0.04879450425505638,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5035774019698941,
      "grad_norm": 0.40724828839302063,
      "learning_rate": 2.3420660739941204e-07,
      "loss": 0.079,
      "mae_dtheta": 0.0074295466765761375,
      "mae_dx": 0.0015520132146775723,
      "mae_dy": 0.0015208869008347392,
      "pose_mae_dtheta": 0.053057096898555756,
      "pose_mae_dx": 0.01870400458574295,
      "pose_mae_dy": 0.022262312471866608,
      "pose_rmse_dtheta": 0.12546534836292267,
      "pose_rmse_dx": 0.04945795610547066,
      "pose_rmse_dy": 0.059010062366724014,
      "pose_rmse_mean": 0.07797779142856598,
      "rmse_dtheta": 0.017940156161785126,
      "rmse_dx": 0.005244019441306591,
      "rmse_dy": 0.00349980010651052,
      "rmse_mean": 0.008894659578800201,
      "rotation_flip": 0.0025432349648326635,
      "sparse_tokens": 32073.0,
      "step": 10839,
      "turn_loss": 0.06346101313829422,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5036238617357368,
      "grad_norm": 0.4791649281978607,
      "learning_rate": 2.338068414753075e-07,
      "loss": 0.083,
      "mae_dtheta": 0.008267946541309357,
      "mae_dx": 0.0013639203971251845,
      "mae_dy": 0.0015006125904619694,
      "pose_mae_dtheta": 0.04714424908161163,
      "pose_mae_dx": 0.018211612477898598,
      "pose_mae_dy": 0.01781724952161312,
      "pose_rmse_dtheta": 0.1340298056602478,
      "pose_rmse_dx": 0.048792824149131775,
      "pose_rmse_dy": 0.045119188725948334,
      "pose_rmse_mean": 0.07598060369491577,
      "rmse_dtheta": 0.020664090290665627,
      "rmse_dx": 0.0045038689859211445,
      "rmse_dy": 0.003431151155382395,
      "rmse_mean": 0.00953303650021553,
      "rotation_flip": 0.002753737149760127,
      "sparse_tokens": 32153.0,
      "step": 10840,
      "turn_loss": 0.08226533234119415,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.5036703215015796,
      "grad_norm": 0.5467181205749512,
      "learning_rate": 2.3340740885364922e-07,
      "loss": 0.0912,
      "mae_dtheta": 0.0393606498837471,
      "mae_dx": 0.009684293530881405,
      "mae_dy": 0.011676095426082611,
      "pose_mae_dtheta": 0.3205586075782776,
      "pose_mae_dx": 0.04757905751466751,
      "pose_mae_dy": 0.12496735900640488,
      "pose_rmse_dtheta": 0.5534636378288269,
      "pose_rmse_dx": 0.11056893318891525,
      "pose_rmse_dy": 0.3143889605998993,
      "pose_rmse_mean": 0.32614052295684814,
      "rmse_dtheta": 0.05921180546283722,
      "rmse_dx": 0.018827106803655624,
      "rmse_dy": 0.02524075098335743,
      "rmse_mean": 0.034426555037498474,
      "rotation_flip": 0.006493506487458944,
      "sparse_tokens": 4677.0,
      "step": 10841,
      "turn_loss": 0.39079412817955017,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5037167812674224,
      "grad_norm": 0.37900450825691223,
      "learning_rate": 2.3300830956236865e-07,
      "loss": 0.1103,
      "mae_dtheta": 0.009417189285159111,
      "mae_dx": 0.0018904907628893852,
      "mae_dy": 0.003014582907781005,
      "pose_mae_dtheta": 0.0551266111433506,
      "pose_mae_dx": 0.023749368265271187,
      "pose_mae_dy": 0.02744629979133606,
      "pose_rmse_dtheta": 0.12139061838388443,
      "pose_rmse_dx": 0.07132238149642944,
      "pose_rmse_dy": 0.06224264204502106,
      "pose_rmse_mean": 0.08498521894216537,
      "rmse_dtheta": 0.020128432661294937,
      "rmse_dx": 0.005651624873280525,
      "rmse_dy": 0.007159027270972729,
      "rmse_mean": 0.010979695245623589,
      "rotation_flip": 0.005295007489621639,
      "sparse_tokens": 32105.0,
      "step": 10842,
      "turn_loss": 0.08951794356107712,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5037632410332652,
      "grad_norm": 0.6298924684524536,
      "learning_rate": 2.3260954362937626e-07,
      "loss": 0.0855,
      "mae_dtheta": 0.006506048142910004,
      "mae_dx": 0.0013842422049492598,
      "mae_dy": 0.0013233667705208063,
      "pose_mae_dtheta": 0.04693390429019928,
      "pose_mae_dx": 0.015141746960580349,
      "pose_mae_dy": 0.015463725663721561,
      "pose_rmse_dtheta": 0.1574806272983551,
      "pose_rmse_dx": 0.04898764193058014,
      "pose_rmse_dy": 0.043648503720760345,
      "pose_rmse_mean": 0.08337225764989853,
      "rmse_dtheta": 0.019115358591079712,
      "rmse_dx": 0.004156708251684904,
      "rmse_dy": 0.0045919702388346195,
      "rmse_mean": 0.009288012981414795,
      "rotation_flip": 0.003508772002533078,
      "sparse_tokens": 32169.0,
      "step": 10843,
      "turn_loss": 0.05310257151722908,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5038097007991079,
      "grad_norm": 0.866088330745697,
      "learning_rate": 2.32211111082557e-07,
      "loss": 0.1519,
      "mae_dtheta": 0.00787551049143076,
      "mae_dx": 0.0007594021153636277,
      "mae_dy": 0.0011044724378734827,
      "pose_mae_dtheta": 0.058640871196985245,
      "pose_mae_dx": 0.012134894728660583,
      "pose_mae_dy": 0.018713850528001785,
      "pose_rmse_dtheta": 0.21038173139095306,
      "pose_rmse_dx": 0.034693025052547455,
      "pose_rmse_dy": 0.05125528201460838,
      "pose_rmse_mean": 0.0987766832113266,
      "rmse_dtheta": 0.022896360605955124,
      "rmse_dx": 0.0024275837931782007,
      "rmse_dy": 0.0025536527391523123,
      "rmse_mean": 0.009292532689869404,
      "rotation_flip": 0.0019361084559932351,
      "sparse_tokens": 32073.0,
      "step": 10844,
      "turn_loss": 0.04572499543428421,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.5038561605649508,
      "grad_norm": 0.6358198523521423,
      "learning_rate": 2.3181301194977413e-07,
      "loss": 0.1385,
      "mae_dtheta": 0.02826518751680851,
      "mae_dx": 0.010110507719218731,
      "mae_dy": 0.0046171569265425205,
      "pose_mae_dtheta": 0.18913871049880981,
      "pose_mae_dx": 0.0817505270242691,
      "pose_mae_dy": 0.0573304109275341,
      "pose_rmse_dtheta": 0.30691200494766235,
      "pose_rmse_dx": 0.18960818648338318,
      "pose_rmse_dy": 0.14378134906291962,
      "pose_rmse_mean": 0.21343384683132172,
      "rmse_dtheta": 0.03997237607836723,
      "rmse_dx": 0.021372392773628235,
      "rmse_dy": 0.008369572460651398,
      "rmse_mean": 0.023238113150000572,
      "rotation_flip": 0.012269938364624977,
      "sparse_tokens": 5617.0,
      "step": 10845,
      "turn_loss": 0.20482154190540314,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5039026203307936,
      "grad_norm": 0.4206863045692444,
      "learning_rate": 2.314152462588659e-07,
      "loss": 0.1052,
      "mae_dtheta": 0.009311188012361526,
      "mae_dx": 0.001790240523405373,
      "mae_dy": 0.002520250855013728,
      "pose_mae_dtheta": 0.059917476028203964,
      "pose_mae_dx": 0.022750183939933777,
      "pose_mae_dy": 0.028690878301858902,
      "pose_rmse_dtheta": 0.13370870053768158,
      "pose_rmse_dx": 0.06091327220201492,
      "pose_rmse_dy": 0.06148268282413483,
      "pose_rmse_mean": 0.08536821603775024,
      "rmse_dtheta": 0.02065788209438324,
      "rmse_dx": 0.005362475756555796,
      "rmse_dy": 0.0051536099053919315,
      "rmse_mean": 0.010391322895884514,
      "rotation_flip": 0.0019127773120999336,
      "sparse_tokens": 32089.0,
      "step": 10846,
      "turn_loss": 0.07800028473138809,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.5039490800966363,
      "grad_norm": 0.6262834072113037,
      "learning_rate": 2.3101781403764955e-07,
      "loss": 0.1039,
      "mae_dtheta": 0.03348340839147568,
      "mae_dx": 0.010777059942483902,
      "mae_dy": 0.0038864833768457174,
      "pose_mae_dtheta": 0.2917364835739136,
      "pose_mae_dx": 0.09376997500658035,
      "pose_mae_dy": 0.052574191242456436,
      "pose_rmse_dtheta": 0.5276168584823608,
      "pose_rmse_dx": 0.23530569672584534,
      "pose_rmse_dy": 0.11152548342943192,
      "pose_rmse_mean": 0.29148268699645996,
      "rmse_dtheta": 0.05406400188803673,
      "rmse_dx": 0.023868966847658157,
      "rmse_dy": 0.007076734211295843,
      "rmse_mean": 0.02833656780421734,
      "rotation_flip": 0.010526316240429878,
      "sparse_tokens": 8560.0,
      "step": 10847,
      "turn_loss": 0.26814550161361694,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5039955398624791,
      "grad_norm": 0.5142390727996826,
      "learning_rate": 2.3062071531391672e-07,
      "loss": 0.1484,
      "mae_dtheta": 0.012726329267024994,
      "mae_dx": 0.0022844343911856413,
      "mae_dy": 0.003796160686761141,
      "pose_mae_dtheta": 0.08466582000255585,
      "pose_mae_dx": 0.028013022616505623,
      "pose_mae_dy": 0.033599063754081726,
      "pose_rmse_dtheta": 0.18669123947620392,
      "pose_rmse_dx": 0.07166040688753128,
      "pose_rmse_dy": 0.08422771096229553,
      "pose_rmse_mean": 0.11419312655925751,
      "rmse_dtheta": 0.025455592200160027,
      "rmse_dx": 0.006489732302725315,
      "rmse_dy": 0.009196311235427856,
      "rmse_mean": 0.013713879510760307,
      "rotation_flip": 0.005442176945507526,
      "sparse_tokens": 32137.0,
      "step": 10848,
      "turn_loss": 0.11361099779605865,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.5040419996283219,
      "grad_norm": 0.9634597301483154,
      "learning_rate": 2.3022395011543687e-07,
      "loss": 0.195,
      "mae_dtheta": 0.03018757700920105,
      "mae_dx": 0.010210664942860603,
      "mae_dy": 0.0036008497700095177,
      "pose_mae_dtheta": 0.2690235674381256,
      "pose_mae_dx": 0.0690142810344696,
      "pose_mae_dy": 0.03550136461853981,
      "pose_rmse_dtheta": 0.46612226963043213,
      "pose_rmse_dx": 0.15704341232776642,
      "pose_rmse_dy": 0.08261159807443619,
      "pose_rmse_mean": 0.23525910079479218,
      "rmse_dtheta": 0.046572063118219376,
      "rmse_dx": 0.02054615318775177,
      "rmse_dy": 0.007681448943912983,
      "rmse_mean": 0.02493322268128395,
      "rotation_flip": 0.011299435049295425,
      "sparse_tokens": 5954.0,
      "step": 10849,
      "turn_loss": 0.2011241912841797,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.5040884593941647,
      "grad_norm": 0.5169400572776794,
      "learning_rate": 2.298275184699572e-07,
      "loss": 0.1123,
      "mae_dtheta": 0.031379520893096924,
      "mae_dx": 0.008797035552561283,
      "mae_dy": 0.004871378652751446,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5169399976730347,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 137.9385986328125,
      "model/head/act_norm_mean": 101.821484375,
      "model/head/act_norm_min": 61.698543548583984,
      "model/head/act_over_embed": 69.97267733025569,
      "model/head/grad_frac": 0.09383378177881241,
      "model/head/grad_norm": 0.04850643500685692,
      "model/head/grad_zero_frac": 0.000174182205228135,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6978732638888889,
      "model/head/update_ratio": 0.0008257261360995471,
      "model/head/weight_delta": 9.978899002075195,
      "model/head/weight_delta_rel": 0.1750594526529312,
      "model/head/weight_norm": 58.74397277832031,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229196310043335,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42285193977775154,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227936267852783,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.290587811817503,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09509915858507156,
      "model/modality_embedder.encoders.pose/grad_norm": 0.049160558730363846,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5312285370879121,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001587365404702723,
      "model/modality_embedder.encoders.pose/weight_delta": 3.155552625656128,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10310173779726028,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969907760620117,
      "model/modality_embedder/grad_frac": 0.09509915858507156,
      "model/modality_embedder/grad_norm": 0.049160558730363846,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5312285370879121,
      "model/modality_embedder/update_ratio": 0.001587365404702723,
      "model/modality_embedder/weight_delta": 3.155552625656128,
      "model/modality_embedder/weight_delta_rel": 0.10310173779726028,
      "model/modality_embedder/weight_norm": 30.969907760620117,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 76.55715942382812,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.824903549382714,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.406046867370605,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.685487409249573,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06122734397649765,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03165086358785629,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001131988363340497,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.738949775695801,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09980898350477219,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960412979125977,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 77.74191284179688,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.603601741622576,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.599019050598145,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.220616097244143,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05808630213141441,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030027132481336594,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010086563415825367,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.47253680229187,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12029138952493668,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.769437789916992,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.1668930053711,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.183746693121694,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.904804229736328,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.306506501464447,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05428089573979378,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02805996686220169,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009127862867899239,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.761955976486206,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12631943821907043,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.741004943847656,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.19145202636719,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.052232142857143,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.439592361450195,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.590547195559036,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.055718742311000824,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.028803246095776558,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009615643066354096,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2334399223327637,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11050362884998322,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954570770263672,
      "model/normalizer/grad_frac": 0.2279757261276245,
      "model/normalizer/grad_norm": 0.11784977465867996,
      "model/normalizer/grad_zero_frac": 0.00025643722619861364,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001498283352702856,
      "model/normalizer/weight_delta": 6.800538539886475,
      "model/normalizer/weight_delta_rel": 0.08758699893951416,
      "model/normalizer/weight_norm": 78.65653228759766,
      "pose_mae_dtheta": 0.2209080159664154,
      "pose_mae_dx": 0.06294471770524979,
      "pose_mae_dy": 0.056224361062049866,
      "pose_rmse_dtheta": 0.3756119906902313,
      "pose_rmse_dx": 0.1477520763874054,
      "pose_rmse_dy": 0.12729090452194214,
      "pose_rmse_mean": 0.21688500046730042,
      "rmse_dtheta": 0.04782548174262047,
      "rmse_dx": 0.01975615881383419,
      "rmse_dy": 0.009766027331352234,
      "rmse_mean": 0.02578255534172058,
      "rotation_flip": 0.01879699155688286,
      "sparse_tokens": 23275.0,
      "step": 10850,
      "turn_loss": 0.262438029050827,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.5041349191600074,
      "grad_norm": 0.6201165914535522,
      "learning_rate": 2.2943142040519838e-07,
      "loss": 0.14,
      "mae_dtheta": 0.022149283438920975,
      "mae_dx": 0.007877935655415058,
      "mae_dy": 0.002889445051550865,
      "pose_mae_dtheta": 0.16346028447151184,
      "pose_mae_dx": 0.0680905431509018,
      "pose_mae_dy": 0.04359826073050499,
      "pose_rmse_dtheta": 0.34387409687042236,
      "pose_rmse_dx": 0.1933990716934204,
      "pose_rmse_dy": 0.11828132718801498,
      "pose_rmse_mean": 0.21851816773414612,
      "rmse_dtheta": 0.04008384048938751,
      "rmse_dx": 0.02021676115691662,
      "rmse_dy": 0.005966710392385721,
      "rmse_mean": 0.02208910509943962,
      "rotation_flip": 0.0161117073148489,
      "sparse_tokens": 23509.0,
      "step": 10851,
      "turn_loss": 0.14698411524295807,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.5041813789258502,
      "grad_norm": 0.5152983069419861,
      "learning_rate": 2.2903565594886212e-07,
      "loss": 0.1272,
      "mae_dtheta": 0.035942383110523224,
      "mae_dx": 0.0069791763089597225,
      "mae_dy": 0.00398856308311224,
      "pose_mae_dtheta": 0.2704380452632904,
      "pose_mae_dx": 0.050670526921749115,
      "pose_mae_dy": 0.05066967010498047,
      "pose_rmse_dtheta": 0.5175097584724426,
      "pose_rmse_dx": 0.12767907977104187,
      "pose_rmse_dy": 0.1323784440755844,
      "pose_rmse_mean": 0.25918909907341003,
      "rmse_dtheta": 0.0557233989238739,
      "rmse_dx": 0.018315421417355537,
      "rmse_dy": 0.008158591575920582,
      "rmse_mean": 0.027399137616157532,
      "rotation_flip": 0.012820512987673283,
      "sparse_tokens": 9972.0,
      "step": 10852,
      "turn_loss": 0.197093665599823,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.504227838691693,
      "grad_norm": 0.3774905800819397,
      "learning_rate": 2.2864022512862183e-07,
      "loss": 0.0501,
      "mae_dtheta": 0.008289421908557415,
      "mae_dx": 0.0011723507195711136,
      "mae_dy": 0.00019284796144347638,
      "pose_mae_dtheta": 0.05760473385453224,
      "pose_mae_dx": 0.00818220991641283,
      "pose_mae_dy": 0.0026362247299402952,
      "pose_rmse_dtheta": 0.25237298011779785,
      "pose_rmse_dx": 0.01717265509068966,
      "pose_rmse_dy": 0.005437261890619993,
      "pose_rmse_mean": 0.09166096895933151,
      "rmse_dtheta": 0.030974671244621277,
      "rmse_dx": 0.00304157636128366,
      "rmse_dy": 0.00041503520333208144,
      "rmse_mean": 0.011477094143629074,
      "rotation_flip": 0.002144772093743086,
      "sparse_tokens": 32249.0,
      "step": 10853,
      "turn_loss": 0.042804524302482605,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30723.0,
      "epoch": 0.5042742984575358,
      "grad_norm": 0.7011163830757141,
      "learning_rate": 2.2824512797213206e-07,
      "loss": 0.1603,
      "mae_dtheta": 0.03749927878379822,
      "mae_dx": 0.013217239640653133,
      "mae_dy": 0.004090421367436647,
      "pose_mae_dtheta": 0.31929802894592285,
      "pose_mae_dx": 0.10611338913440704,
      "pose_mae_dy": 0.04880258068442345,
      "pose_rmse_dtheta": 0.5094362497329712,
      "pose_rmse_dx": 0.22795525193214417,
      "pose_rmse_dy": 0.12724077701568604,
      "pose_rmse_mean": 0.28821074962615967,
      "rmse_dtheta": 0.054018523544073105,
      "rmse_dx": 0.025241615250706673,
      "rmse_dy": 0.007439158856868744,
      "rmse_mean": 0.028899766504764557,
      "rotation_flip": 0.019754769280552864,
      "sparse_tokens": 22127.0,
      "step": 10854,
      "turn_loss": 0.264358788728714,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5043207582233785,
      "grad_norm": 0.2997693419456482,
      "learning_rate": 2.2785036450702237e-07,
      "loss": 0.0691,
      "mae_dtheta": 0.006379241589456797,
      "mae_dx": 0.0013347165659070015,
      "mae_dy": 0.0015486195916309953,
      "pose_mae_dtheta": 0.04080890864133835,
      "pose_mae_dx": 0.014674214646220207,
      "pose_mae_dy": 0.018476270139217377,
      "pose_rmse_dtheta": 0.09422943741083145,
      "pose_rmse_dx": 0.039310671389102936,
      "pose_rmse_dy": 0.04711964353919029,
      "pose_rmse_mean": 0.06021992117166519,
      "rmse_dtheta": 0.015826813876628876,
      "rmse_dx": 0.003992181271314621,
      "rmse_dy": 0.004202730488032103,
      "rmse_mean": 0.00800724234431982,
      "rotation_flip": 0.008337193168699741,
      "sparse_tokens": 32105.0,
      "step": 10855,
      "turn_loss": 0.05500957369804382,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5043672179892214,
      "grad_norm": 0.3721165657043457,
      "learning_rate": 2.2745593476089734e-07,
      "loss": 0.0695,
      "mae_dtheta": 0.008184054866433144,
      "mae_dx": 0.0015652475412935019,
      "mae_dy": 0.0017194155370816588,
      "pose_mae_dtheta": 0.05525466799736023,
      "pose_mae_dx": 0.01775345951318741,
      "pose_mae_dy": 0.020414849743247032,
      "pose_rmse_dtheta": 0.1325313299894333,
      "pose_rmse_dx": 0.050218962132930756,
      "pose_rmse_dy": 0.050490524619817734,
      "pose_rmse_mean": 0.07774694263935089,
      "rmse_dtheta": 0.019560668617486954,
      "rmse_dx": 0.0053893644362688065,
      "rmse_dy": 0.004446377977728844,
      "rmse_mean": 0.009798804298043251,
      "rotation_flip": 0.0030303029343485832,
      "sparse_tokens": 32089.0,
      "step": 10856,
      "turn_loss": 0.06487817317247391,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5044136777550641,
      "grad_norm": 0.631015956401825,
      "learning_rate": 2.2706183876134047e-07,
      "loss": 0.106,
      "mae_dtheta": 0.00913901999592781,
      "mae_dx": 0.0013428828679025173,
      "mae_dy": 0.0020875700283795595,
      "pose_mae_dtheta": 0.05859886854887009,
      "pose_mae_dx": 0.016591332852840424,
      "pose_mae_dy": 0.02167925424873829,
      "pose_rmse_dtheta": 0.1608174443244934,
      "pose_rmse_dx": 0.04682254046201706,
      "pose_rmse_dy": 0.04941045492887497,
      "pose_rmse_mean": 0.08568348735570908,
      "rmse_dtheta": 0.020896118134260178,
      "rmse_dx": 0.004202459007501602,
      "rmse_dy": 0.004806713666766882,
      "rmse_mean": 0.009968430735170841,
      "rotation_flip": 0.00991669949144125,
      "sparse_tokens": 32073.0,
      "step": 10857,
      "turn_loss": 0.07455796748399734,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.5044601375209069,
      "grad_norm": 0.5133525729179382,
      "learning_rate": 2.2666807653591082e-07,
      "loss": 0.1092,
      "mae_dtheta": 0.022174756973981857,
      "mae_dx": 0.009177319705486298,
      "mae_dy": 0.008471704088151455,
      "pose_mae_dtheta": 0.15176691114902496,
      "pose_mae_dx": 0.09396917372941971,
      "pose_mae_dy": 0.1185997873544693,
      "pose_rmse_dtheta": 0.2146313190460205,
      "pose_rmse_dx": 0.2043222188949585,
      "pose_rmse_dy": 0.20048071444034576,
      "pose_rmse_mean": 0.206478089094162,
      "rmse_dtheta": 0.03203071281313896,
      "rmse_dx": 0.02243117243051529,
      "rmse_dy": 0.011943886987864971,
      "rmse_mean": 0.022135257720947266,
      "rotation_flip": 0.007246376946568489,
      "sparse_tokens": 5527.0,
      "step": 10858,
      "turn_loss": 0.18911059200763702,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.5045065972867496,
      "grad_norm": 0.5485196709632874,
      "learning_rate": 2.2627464811214528e-07,
      "loss": 0.1016,
      "mae_dtheta": 0.030299313366413116,
      "mae_dx": 0.008427503518760204,
      "mae_dy": 0.004305470734834671,
      "pose_mae_dtheta": 0.2507743239402771,
      "pose_mae_dx": 0.0621873140335083,
      "pose_mae_dy": 0.04152986407279968,
      "pose_rmse_dtheta": 0.48353374004364014,
      "pose_rmse_dx": 0.13500003516674042,
      "pose_rmse_dy": 0.11011330038309097,
      "pose_rmse_mean": 0.2428823709487915,
      "rmse_dtheta": 0.05017862468957901,
      "rmse_dx": 0.018218208104372025,
      "rmse_dy": 0.010122104547917843,
      "rmse_mean": 0.026172980666160583,
      "rotation_flip": 0.020118342712521553,
      "sparse_tokens": 14181.0,
      "step": 10859,
      "turn_loss": 0.2551345229148865,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5045530570525925,
      "grad_norm": 0.5088757276535034,
      "learning_rate": 2.2588155351755513e-07,
      "loss": 0.1277,
      "mae_dtheta": 0.008428306318819523,
      "mae_dx": 0.0015963170444592834,
      "mae_dy": 0.0022597694769501686,
      "pose_mae_dtheta": 0.05528329312801361,
      "pose_mae_dx": 0.022225165739655495,
      "pose_mae_dy": 0.02358921803534031,
      "pose_rmse_dtheta": 0.1630759984254837,
      "pose_rmse_dx": 0.06176332011818886,
      "pose_rmse_dy": 0.053340982645750046,
      "pose_rmse_mean": 0.09272676706314087,
      "rmse_dtheta": 0.020112529397010803,
      "rmse_dx": 0.004868244752287865,
      "rmse_dy": 0.005228426307439804,
      "rmse_mean": 0.01006973348557949,
      "rotation_flip": 0.004029009025543928,
      "sparse_tokens": 32121.0,
      "step": 10860,
      "turn_loss": 0.07334362715482712,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.5045995168184353,
      "grad_norm": 0.45150676369667053,
      "learning_rate": 2.2548879277963065e-07,
      "loss": 0.0884,
      "mae_dtheta": 0.03617255762219429,
      "mae_dx": 0.010747049935162067,
      "mae_dy": 0.004474630579352379,
      "pose_mae_dtheta": 0.2992081940174103,
      "pose_mae_dx": 0.09232817590236664,
      "pose_mae_dy": 0.029666030779480934,
      "pose_rmse_dtheta": 0.5151358842849731,
      "pose_rmse_dx": 0.20287027955055237,
      "pose_rmse_dy": 0.06371817737817764,
      "pose_rmse_mean": 0.2605747878551483,
      "rmse_dtheta": 0.05556142330169678,
      "rmse_dx": 0.020983418449759483,
      "rmse_dy": 0.009610503911972046,
      "rmse_mean": 0.02871844917535782,
      "rotation_flip": 0.015202702954411507,
      "sparse_tokens": 9093.0,
      "step": 10861,
      "turn_loss": 0.27796679735183716,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.504645976584278,
      "grad_norm": 1.2491035461425781,
      "learning_rate": 2.250963659258376e-07,
      "loss": 0.328,
      "mae_dtheta": 0.028836341574788094,
      "mae_dx": 0.005954749882221222,
      "mae_dy": 0.0027267197147011757,
      "pose_mae_dtheta": 0.18648312985897064,
      "pose_mae_dx": 0.043272990733385086,
      "pose_mae_dy": 0.017079627141356468,
      "pose_rmse_dtheta": 0.3246347904205322,
      "pose_rmse_dx": 0.08560427278280258,
      "pose_rmse_dy": 0.03908848017454147,
      "pose_rmse_mean": 0.14977586269378662,
      "rmse_dtheta": 0.044122114777565,
      "rmse_dx": 0.013269052840769291,
      "rmse_dy": 0.005785676185041666,
      "rmse_mean": 0.02105894684791565,
      "rotation_flip": 0.009685230441391468,
      "sparse_tokens": 6633.0,
      "step": 10862,
      "turn_loss": 0.1936734914779663,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.5046924363501208,
      "grad_norm": 0.45151591300964355,
      "learning_rate": 2.2470427298361797e-07,
      "loss": 0.1212,
      "mae_dtheta": 0.037285368889570236,
      "mae_dx": 0.007610494736582041,
      "mae_dy": 0.003980456385761499,
      "pose_mae_dtheta": 0.29003921151161194,
      "pose_mae_dx": 0.05880718678236008,
      "pose_mae_dy": 0.04793500155210495,
      "pose_rmse_dtheta": 0.5462058186531067,
      "pose_rmse_dx": 0.12102822959423065,
      "pose_rmse_dy": 0.1295112669467926,
      "pose_rmse_mean": 0.26558178663253784,
      "rmse_dtheta": 0.05838896706700325,
      "rmse_dx": 0.01668533682823181,
      "rmse_dy": 0.009612233377993107,
      "rmse_mean": 0.028228845447301865,
      "rotation_flip": 0.009960159659385681,
      "sparse_tokens": 16450.0,
      "step": 10863,
      "turn_loss": 0.254684180021286,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.5047388961159636,
      "grad_norm": 0.35667750239372253,
      "learning_rate": 2.2431251398039255e-07,
      "loss": 0.1092,
      "mae_dtheta": 0.03211876004934311,
      "mae_dx": 0.011911598034203053,
      "mae_dy": 0.0035710155498236418,
      "pose_mae_dtheta": 0.2497362345457077,
      "pose_mae_dx": 0.0955318734049797,
      "pose_mae_dy": 0.06120799854397774,
      "pose_rmse_dtheta": 0.4762367308139801,
      "pose_rmse_dx": 0.23905369639396667,
      "pose_rmse_dy": 0.13818615674972534,
      "pose_rmse_mean": 0.2844921946525574,
      "rmse_dtheta": 0.0509658120572567,
      "rmse_dx": 0.025968439877033234,
      "rmse_dy": 0.00651902612298727,
      "rmse_mean": 0.027817759662866592,
      "rotation_flip": 0.02412545308470726,
      "sparse_tokens": 17349.0,
      "step": 10864,
      "turn_loss": 0.23968221247196198,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 27254.0,
      "epoch": 0.5047853558818064,
      "grad_norm": 0.518578052520752,
      "learning_rate": 2.2392108894355557e-07,
      "loss": 0.1343,
      "mae_dtheta": 0.034554433077573776,
      "mae_dx": 0.01136322133243084,
      "mae_dy": 0.0030599862802773714,
      "pose_mae_dtheta": 0.27241671085357666,
      "pose_mae_dx": 0.08550792932510376,
      "pose_mae_dy": 0.032105062156915665,
      "pose_rmse_dtheta": 0.47560450434684753,
      "pose_rmse_dx": 0.20629660785198212,
      "pose_rmse_dy": 0.08131209760904312,
      "pose_rmse_mean": 0.2544044256210327,
      "rmse_dtheta": 0.05273814871907234,
      "rmse_dx": 0.023339275270700455,
      "rmse_dy": 0.0070425765588879585,
      "rmse_mean": 0.02770666778087616,
      "rotation_flip": 0.013919414021074772,
      "sparse_tokens": 19713.0,
      "step": 10865,
      "turn_loss": 0.2737533152103424,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.5048318156476491,
      "grad_norm": 0.7654879093170166,
      "learning_rate": 2.2352999790048124e-07,
      "loss": 0.1647,
      "mae_dtheta": 0.03411418944597244,
      "mae_dx": 0.006652587093412876,
      "mae_dy": 0.00454086484387517,
      "pose_mae_dtheta": 0.2590852975845337,
      "pose_mae_dx": 0.050587233155965805,
      "pose_mae_dy": 0.05906374752521515,
      "pose_rmse_dtheta": 0.5153785347938538,
      "pose_rmse_dx": 0.14381635189056396,
      "pose_rmse_dy": 0.12265219539403915,
      "pose_rmse_mean": 0.2606157064437866,
      "rmse_dtheta": 0.057115588337183,
      "rmse_dx": 0.01684526354074478,
      "rmse_dy": 0.009188957512378693,
      "rmse_mean": 0.027716604992747307,
      "rotation_flip": 0.010989011265337467,
      "sparse_tokens": 11717.0,
      "step": 10866,
      "turn_loss": 0.23039387166500092,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 14295.0,
      "epoch": 0.504878275413492,
      "grad_norm": 0.8101197481155396,
      "learning_rate": 2.2313924087851657e-07,
      "loss": 0.2707,
      "mae_dtheta": 0.03144992142915726,
      "mae_dx": 0.0068952529691159725,
      "mae_dy": 0.004576359875500202,
      "pose_mae_dtheta": 0.24598747491836548,
      "pose_mae_dx": 0.06403549760580063,
      "pose_mae_dy": 0.04640751704573631,
      "pose_rmse_dtheta": 0.4280569553375244,
      "pose_rmse_dx": 0.14984111487865448,
      "pose_rmse_dy": 0.1047787293791771,
      "pose_rmse_mean": 0.2275589406490326,
      "rmse_dtheta": 0.048565737903118134,
      "rmse_dx": 0.015855751931667328,
      "rmse_dy": 0.00904737040400505,
      "rmse_mean": 0.024489622563123703,
      "rotation_flip": 0.009735744446516037,
      "sparse_tokens": 11896.0,
      "step": 10867,
      "turn_loss": 0.25486791133880615,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5049247351793347,
      "grad_norm": 0.9675495028495789,
      "learning_rate": 2.2274881790498914e-07,
      "loss": 0.1397,
      "mae_dtheta": 0.0073987990617752075,
      "mae_dx": 0.002934638410806656,
      "mae_dy": 0.0015119628515094519,
      "pose_mae_dtheta": 0.04890378937125206,
      "pose_mae_dx": 0.03010881505906582,
      "pose_mae_dy": 0.018232150003314018,
      "pose_rmse_dtheta": 0.13738374412059784,
      "pose_rmse_dx": 0.08051036298274994,
      "pose_rmse_dy": 0.04898723214864731,
      "pose_rmse_mean": 0.08896045386791229,
      "rmse_dtheta": 0.019570929929614067,
      "rmse_dx": 0.00898794922977686,
      "rmse_dy": 0.003416576189920306,
      "rmse_mean": 0.010658485814929008,
      "rotation_flip": 0.0018575851572677493,
      "sparse_tokens": 32057.0,
      "step": 10868,
      "turn_loss": 0.09798914194107056,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5049711949451775,
      "grad_norm": 0.3893124461174011,
      "learning_rate": 2.2235872900720156e-07,
      "loss": 0.0864,
      "mae_dtheta": 0.009518461301922798,
      "mae_dx": 0.0017255146522074938,
      "mae_dy": 0.002116511110216379,
      "pose_mae_dtheta": 0.06371782720088959,
      "pose_mae_dx": 0.019621944054961205,
      "pose_mae_dy": 0.02462851256132126,
      "pose_rmse_dtheta": 0.18926924467086792,
      "pose_rmse_dx": 0.05428019538521767,
      "pose_rmse_dy": 0.06018894538283348,
      "pose_rmse_mean": 0.10124613344669342,
      "rmse_dtheta": 0.022908205166459084,
      "rmse_dx": 0.005826964974403381,
      "rmse_dy": 0.005548163782805204,
      "rmse_mean": 0.01142777781933546,
      "rotation_flip": 0.004935459233820438,
      "sparse_tokens": 32121.0,
      "step": 10869,
      "turn_loss": 0.08207624405622482,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.5050176547110202,
      "grad_norm": 0.6426639556884766,
      "learning_rate": 2.2196897421243147e-07,
      "loss": 0.1138,
      "mae_dtheta": 0.025930576026439667,
      "mae_dx": 0.011826210655272007,
      "mae_dy": 0.0030889958143234253,
      "pose_mae_dtheta": 0.22076155245304108,
      "pose_mae_dx": 0.09769069403409958,
      "pose_mae_dy": 0.03701378405094147,
      "pose_rmse_dtheta": 0.4448341429233551,
      "pose_rmse_dx": 0.2296527773141861,
      "pose_rmse_dy": 0.1031033843755722,
      "pose_rmse_mean": 0.25919678807258606,
      "rmse_dtheta": 0.04482332989573479,
      "rmse_dx": 0.025390388444066048,
      "rmse_dy": 0.006562994793057442,
      "rmse_mean": 0.02559223771095276,
      "rotation_flip": 0.010791366919875145,
      "sparse_tokens": 11774.0,
      "step": 10870,
      "turn_loss": 0.24349302053451538,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 21099.0,
      "epoch": 0.5050641144768631,
      "grad_norm": 0.5131015777587891,
      "learning_rate": 2.2157955354793648e-07,
      "loss": 0.1773,
      "mae_dtheta": 0.03021138906478882,
      "mae_dx": 0.007829414680600166,
      "mae_dy": 0.005700170993804932,
      "pose_mae_dtheta": 0.23994997143745422,
      "pose_mae_dx": 0.06208739057183266,
      "pose_mae_dy": 0.08328975737094879,
      "pose_rmse_dtheta": 0.430631548166275,
      "pose_rmse_dx": 0.13678787648677826,
      "pose_rmse_dy": 0.19923803210258484,
      "pose_rmse_mean": 0.2555525004863739,
      "rmse_dtheta": 0.04682542756199837,
      "rmse_dx": 0.01830136775970459,
      "rmse_dy": 0.010232223197817802,
      "rmse_mean": 0.02511967346072197,
      "rotation_flip": 0.013461538590490818,
      "sparse_tokens": 17617.0,
      "step": 10871,
      "turn_loss": 0.23426631093025208,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5051105742427058,
      "grad_norm": 0.5608421564102173,
      "learning_rate": 2.211904670409476e-07,
      "loss": 0.1205,
      "mae_dtheta": 0.007238141261041164,
      "mae_dx": 0.0014419581275433302,
      "mae_dy": 0.0014014082262292504,
      "pose_mae_dtheta": 0.0510447733104229,
      "pose_mae_dx": 0.012861231341958046,
      "pose_mae_dy": 0.016405992209911346,
      "pose_rmse_dtheta": 0.1758994162082672,
      "pose_rmse_dx": 0.03665883094072342,
      "pose_rmse_dy": 0.04476067051291466,
      "pose_rmse_mean": 0.08577297627925873,
      "rmse_dtheta": 0.021953480318188667,
      "rmse_dx": 0.004670792259275913,
      "rmse_dy": 0.005081361159682274,
      "rmse_mean": 0.010568544268608093,
      "rotation_flip": 0.0024826216977089643,
      "sparse_tokens": 32137.0,
      "step": 10872,
      "turn_loss": 0.06371332705020905,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.5051570340085486,
      "grad_norm": 0.5163112878799438,
      "learning_rate": 2.2080171471867362e-07,
      "loss": 0.1229,
      "mae_dtheta": 0.03100966103374958,
      "mae_dx": 0.010337166488170624,
      "mae_dy": 0.005833731964230537,
      "pose_mae_dtheta": 0.2340277135372162,
      "pose_mae_dx": 0.07740186154842377,
      "pose_mae_dy": 0.06529944390058517,
      "pose_rmse_dtheta": 0.4074822664260864,
      "pose_rmse_dx": 0.1792600303888321,
      "pose_rmse_dy": 0.13942615687847137,
      "pose_rmse_mean": 0.24205616116523743,
      "rmse_dtheta": 0.04624250903725624,
      "rmse_dx": 0.0215131975710392,
      "rmse_dy": 0.010260092094540596,
      "rmse_mean": 0.02600526623427868,
      "rotation_flip": 0.008561643771827221,
      "sparse_tokens": 17640.0,
      "step": 10873,
      "turn_loss": 0.2545933723449707,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5052034937743913,
      "grad_norm": 0.42092108726501465,
      "learning_rate": 2.2041329660830223e-07,
      "loss": 0.0863,
      "mae_dtheta": 0.008036596700549126,
      "mae_dx": 0.0009183508809655905,
      "mae_dy": 0.0015141416806727648,
      "pose_mae_dtheta": 0.04656807333230972,
      "pose_mae_dx": 0.01236726250499487,
      "pose_mae_dy": 0.014612409286201,
      "pose_rmse_dtheta": 0.1411116123199463,
      "pose_rmse_dx": 0.031659942120313644,
      "pose_rmse_dy": 0.03276963159441948,
      "pose_rmse_mean": 0.06851373612880707,
      "rmse_dtheta": 0.0217851921916008,
      "rmse_dx": 0.0027138758450746536,
      "rmse_dy": 0.003348009428009391,
      "rmse_mean": 0.009282359853386879,
      "rotation_flip": 0.002574002603068948,
      "sparse_tokens": 32105.0,
      "step": 10874,
      "turn_loss": 0.05901535972952843,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.5052499535402342,
      "grad_norm": 0.5665696859359741,
      "learning_rate": 2.2002521273699396e-07,
      "loss": 0.1041,
      "mae_dtheta": 0.025791898369789124,
      "mae_dx": 0.004958420991897583,
      "mae_dy": 0.002336114412173629,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5665695667266846,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 166.64608764648438,
      "model/head/act_norm_mean": 118.4606045809659,
      "model/head/act_norm_min": 78.06462097167969,
      "model/head/act_over_embed": 81.40723651369316,
      "model/head/grad_frac": 0.12254370003938675,
      "model/head/grad_norm": 0.06942953169345856,
      "model/head/grad_zero_frac": 0.0001608567836228758,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6945578835227273,
      "model/head/update_ratio": 0.001181899569928646,
      "model/head/weight_delta": 9.97931957244873,
      "model/head/weight_delta_rel": 0.17506682872772217,
      "model/head/weight_norm": 58.744022369384766,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228937327861786,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228515625,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227904677391052,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905875525487,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05879804119467735,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03331318125128746,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5446671195652174,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001075663953088224,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1552162170410156,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10309074819087982,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969877243041992,
      "model/modality_embedder/grad_frac": 0.05879804119467735,
      "model/modality_embedder/grad_norm": 0.03331318125128746,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5446671195652174,
      "model/modality_embedder/update_ratio": 0.001075663953088224,
      "model/modality_embedder/weight_delta": 3.1552162170410156,
      "model/modality_embedder/weight_delta_rel": 0.10309074819087982,
      "model/modality_embedder/weight_norm": 30.969877243041992,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.14511108398438,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.407800099206348,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.953492164611816,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.773268737599356,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08503296226263046,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0481770895421505,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0017230432713404298,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.739198684692383,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09981805086135864,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960464477539062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.1630859375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.211275703463205,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.791420936584473,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.32542469510179,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08371445536613464,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04743006452918053,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015932404203340411,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4728875160217285,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12030354142189026,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76955795288086,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.30645751953125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.832524463383837,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.885238647460938,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.439562021289277,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09427858144044876,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05341537669301033,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0017375861061736941,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7623403072357178,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1263323426246643,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.741140365600586,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.04266357421875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.578268736471863,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.729244232177734,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.639253829670757,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09336134046316147,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.052895694971084595,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017658581491559744,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.233804225921631,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11051607877016068,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954668045043945,
      "model/normalizer/grad_frac": 0.3740496039390564,
      "model/normalizer/grad_norm": 0.21192511916160583,
      "model/normalizer/grad_zero_frac": 0.0001654433726798743,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0026943066623061895,
      "model/normalizer/weight_delta": 6.801229000091553,
      "model/normalizer/weight_delta_rel": 0.08759589493274689,
      "model/normalizer/weight_norm": 78.65664672851562,
      "pose_mae_dtheta": 0.18383295834064484,
      "pose_mae_dx": 0.04327879101037979,
      "pose_mae_dy": 0.02697617933154106,
      "pose_rmse_dtheta": 0.413021057844162,
      "pose_rmse_dx": 0.09925785660743713,
      "pose_rmse_dy": 0.06604748964309692,
      "pose_rmse_mean": 0.19277547299861908,
      "rmse_dtheta": 0.04748383164405823,
      "rmse_dx": 0.013914748094975948,
      "rmse_dy": 0.004274911247193813,
      "rmse_mean": 0.021891165524721146,
      "rotation_flip": 0.004065040498971939,
      "sparse_tokens": 6175.0,
      "step": 10875,
      "turn_loss": 0.1698693186044693,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5052964133060769,
      "grad_norm": 0.7272748947143555,
      "learning_rate": 2.1963746313188762e-07,
      "loss": 0.2056,
      "mae_dtheta": 0.013197526335716248,
      "mae_dx": 0.005142711102962494,
      "mae_dy": 0.0045529925264418125,
      "pose_mae_dtheta": 0.10202539712190628,
      "pose_mae_dx": 0.0463840551674366,
      "pose_mae_dy": 0.042287878692150116,
      "pose_rmse_dtheta": 0.2585950791835785,
      "pose_rmse_dx": 0.12834526598453522,
      "pose_rmse_dy": 0.11383911967277527,
      "pose_rmse_mean": 0.16692650318145752,
      "rmse_dtheta": 0.028986893594264984,
      "rmse_dx": 0.01433313637971878,
      "rmse_dy": 0.011356578208506107,
      "rmse_mean": 0.0182255357503891,
      "rotation_flip": 0.00906225387006998,
      "sparse_tokens": 32073.0,
      "step": 10876,
      "turn_loss": 0.14768293499946594,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5053428730719197,
      "grad_norm": 0.36534175276756287,
      "learning_rate": 2.1925004782009983e-07,
      "loss": 0.0946,
      "mae_dtheta": 0.007556380704045296,
      "mae_dx": 0.0017682157922536135,
      "mae_dy": 0.002776759909465909,
      "pose_mae_dtheta": 0.050747279077768326,
      "pose_mae_dx": 0.022449219599366188,
      "pose_mae_dy": 0.02433086931705475,
      "pose_rmse_dtheta": 0.11995084583759308,
      "pose_rmse_dx": 0.07618975639343262,
      "pose_rmse_dy": 0.05409621074795723,
      "pose_rmse_mean": 0.0834122747182846,
      "rmse_dtheta": 0.016753612086176872,
      "rmse_dx": 0.005229587201029062,
      "rmse_dy": 0.007427089847624302,
      "rmse_mean": 0.009803429245948792,
      "rotation_flip": 0.004545454401522875,
      "sparse_tokens": 32089.0,
      "step": 10877,
      "turn_loss": 0.07170209288597107,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.5053893328377626,
      "grad_norm": 0.5322043895721436,
      "learning_rate": 2.1886296682872176e-07,
      "loss": 0.1588,
      "mae_dtheta": 0.021324891597032547,
      "mae_dx": 0.008700299076735973,
      "mae_dy": 0.0041574095375835896,
      "pose_mae_dtheta": 0.16109773516654968,
      "pose_mae_dx": 0.07047345489263535,
      "pose_mae_dy": 0.03756778687238693,
      "pose_rmse_dtheta": 0.2789122462272644,
      "pose_rmse_dx": 0.16548700630664825,
      "pose_rmse_dy": 0.07825525850057602,
      "pose_rmse_mean": 0.17421816289424896,
      "rmse_dtheta": 0.03416711091995239,
      "rmse_dx": 0.019804801791906357,
      "rmse_dy": 0.008269191719591618,
      "rmse_mean": 0.02074703574180603,
      "rotation_flip": 0.006172839552164078,
      "sparse_tokens": 8338.0,
      "step": 10878,
      "turn_loss": 0.2141747623682022,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 24662.0,
      "epoch": 0.5054357926036053,
      "grad_norm": 0.6659340858459473,
      "learning_rate": 2.1847622018482283e-07,
      "loss": 0.1574,
      "mae_dtheta": 0.024789895862340927,
      "mae_dx": 0.011262836866080761,
      "mae_dy": 0.004946284927427769,
      "pose_mae_dtheta": 0.1715603619813919,
      "pose_mae_dx": 0.08384867757558823,
      "pose_mae_dy": 0.060460399836301804,
      "pose_rmse_dtheta": 0.3210473954677582,
      "pose_rmse_dx": 0.2101295292377472,
      "pose_rmse_dy": 0.1712440848350525,
      "pose_rmse_mean": 0.2341403365135193,
      "rmse_dtheta": 0.04141329601407051,
      "rmse_dx": 0.024454792961478233,
      "rmse_dy": 0.01272283960133791,
      "rmse_mean": 0.026196977123618126,
      "rotation_flip": 0.01820250228047371,
      "sparse_tokens": 19617.0,
      "step": 10879,
      "turn_loss": 0.2797667384147644,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.5054822523694481,
      "grad_norm": 0.6608145833015442,
      "learning_rate": 2.180898079154481e-07,
      "loss": 0.149,
      "mae_dtheta": 0.01995285414159298,
      "mae_dx": 0.011625691317021847,
      "mae_dy": 0.0018729050643742085,
      "pose_mae_dtheta": 0.1391768455505371,
      "pose_mae_dx": 0.0942101925611496,
      "pose_mae_dy": 0.023685885593295097,
      "pose_rmse_dtheta": 0.3172163665294647,
      "pose_rmse_dx": 0.22690576314926147,
      "pose_rmse_dy": 0.07566121220588684,
      "pose_rmse_mean": 0.20659443736076355,
      "rmse_dtheta": 0.03861096873879433,
      "rmse_dx": 0.02464279904961586,
      "rmse_dy": 0.004709556233137846,
      "rmse_mean": 0.022654442116618156,
      "rotation_flip": 0.012847965583205223,
      "sparse_tokens": 11511.0,
      "step": 10880,
      "turn_loss": 0.13802534341812134,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5055287121352908,
      "grad_norm": 0.5927257537841797,
      "learning_rate": 2.1770373004762035e-07,
      "loss": 0.1291,
      "mae_dtheta": 0.012820029631257057,
      "mae_dx": 0.001762094208970666,
      "mae_dy": 0.001622565439902246,
      "pose_mae_dtheta": 0.09261540323495865,
      "pose_mae_dx": 0.02061665803194046,
      "pose_mae_dy": 0.021287180483341217,
      "pose_rmse_dtheta": 0.2699306905269623,
      "pose_rmse_dx": 0.05404101312160492,
      "pose_rmse_dy": 0.05047772079706192,
      "pose_rmse_mean": 0.12481646984815598,
      "rmse_dtheta": 0.03006310947239399,
      "rmse_dx": 0.005782063119113445,
      "rmse_dy": 0.0033725856337696314,
      "rmse_mean": 0.013072586618363857,
      "rotation_flip": 0.0030094583053141832,
      "sparse_tokens": 32121.0,
      "step": 10881,
      "turn_loss": 0.08248128741979599,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5055751719011337,
      "grad_norm": 0.4092593193054199,
      "learning_rate": 2.1731798660833635e-07,
      "loss": 0.1115,
      "mae_dtheta": 0.009060531854629517,
      "mae_dx": 0.001073829596862197,
      "mae_dy": 0.0020878170616924763,
      "pose_mae_dtheta": 0.05581336468458176,
      "pose_mae_dx": 0.016627995297312737,
      "pose_mae_dy": 0.028369486331939697,
      "pose_rmse_dtheta": 0.10724420845508575,
      "pose_rmse_dx": 0.05024596303701401,
      "pose_rmse_dy": 0.06363096088171005,
      "pose_rmse_mean": 0.07370704412460327,
      "rmse_dtheta": 0.01704983413219452,
      "rmse_dx": 0.00370805524289608,
      "rmse_dy": 0.004514997359365225,
      "rmse_mean": 0.008424296043813229,
      "rotation_flip": 0.00458906963467598,
      "sparse_tokens": 32057.0,
      "step": 10882,
      "turn_loss": 0.07293593883514404,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.5056216316669764,
      "grad_norm": 0.5980189442634583,
      "learning_rate": 2.1693257762457399e-07,
      "loss": 0.1764,
      "mae_dtheta": 0.026511669158935547,
      "mae_dx": 0.0085908193141222,
      "mae_dy": 0.004799381829798222,
      "pose_mae_dtheta": 0.21346265077590942,
      "pose_mae_dx": 0.08351684361696243,
      "pose_mae_dy": 0.07010579854249954,
      "pose_rmse_dtheta": 0.4240395128726959,
      "pose_rmse_dx": 0.20799024403095245,
      "pose_rmse_dy": 0.1643408238887787,
      "pose_rmse_mean": 0.265456885099411,
      "rmse_dtheta": 0.04389628767967224,
      "rmse_dx": 0.02118033729493618,
      "rmse_dy": 0.008600008673965931,
      "rmse_mean": 0.02455887943506241,
      "rotation_flip": 0.009259259328246117,
      "sparse_tokens": 10997.0,
      "step": 10883,
      "turn_loss": 0.1978480964899063,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5056680914328192,
      "grad_norm": 0.36021846532821655,
      "learning_rate": 2.1654750312328222e-07,
      "loss": 0.0876,
      "mae_dtheta": 0.00802709348499775,
      "mae_dx": 0.0011715971631929278,
      "mae_dy": 0.0015941087622195482,
      "pose_mae_dtheta": 0.04871237650513649,
      "pose_mae_dx": 0.013130931183695793,
      "pose_mae_dy": 0.020868491381406784,
      "pose_rmse_dtheta": 0.12464766949415207,
      "pose_rmse_dx": 0.030769141390919685,
      "pose_rmse_dy": 0.051424868404865265,
      "pose_rmse_mean": 0.06894722580909729,
      "rmse_dtheta": 0.01789851114153862,
      "rmse_dx": 0.0037452823016792536,
      "rmse_dy": 0.003943752497434616,
      "rmse_mean": 0.008529182523488998,
      "rotation_flip": 0.0021897810511291027,
      "sparse_tokens": 32105.0,
      "step": 10884,
      "turn_loss": 0.0618002824485302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5057145511986619,
      "grad_norm": 0.4564685821533203,
      "learning_rate": 2.161627631313923e-07,
      "loss": 0.0989,
      "mae_dtheta": 0.009185781702399254,
      "mae_dx": 0.0017548889154568315,
      "mae_dy": 0.001978890737518668,
      "pose_mae_dtheta": 0.06210808828473091,
      "pose_mae_dx": 0.01854441501200199,
      "pose_mae_dy": 0.022378649562597275,
      "pose_rmse_dtheta": 0.18391570448875427,
      "pose_rmse_dx": 0.049068816006183624,
      "pose_rmse_dy": 0.056538764387369156,
      "pose_rmse_mean": 0.09650775790214539,
      "rmse_dtheta": 0.022214291617274284,
      "rmse_dx": 0.005452054552733898,
      "rmse_dy": 0.004606927279382944,
      "rmse_mean": 0.010757758282124996,
      "rotation_flip": 0.0047846888191998005,
      "sparse_tokens": 32073.0,
      "step": 10885,
      "turn_loss": 0.06737630069255829,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5057610109645048,
      "grad_norm": 0.35826918482780457,
      "learning_rate": 2.1577835767580713e-07,
      "loss": 0.0589,
      "mae_dtheta": 0.004000093787908554,
      "mae_dx": 0.0012687931302934885,
      "mae_dy": 0.00033371910103596747,
      "pose_mae_dtheta": 0.0291973315179348,
      "pose_mae_dx": 0.0111343739554286,
      "pose_mae_dy": 0.004418679513037205,
      "pose_rmse_dtheta": 0.1628498136997223,
      "pose_rmse_dx": 0.03479692339897156,
      "pose_rmse_dy": 0.012662610970437527,
      "pose_rmse_mean": 0.07010311633348465,
      "rmse_dtheta": 0.018597139045596123,
      "rmse_dx": 0.004370030015707016,
      "rmse_dy": 0.0009868212509900331,
      "rmse_mean": 0.007984664291143417,
      "rotation_flip": 0.0023980815894901752,
      "sparse_tokens": 32137.0,
      "step": 10886,
      "turn_loss": 0.031204594299197197,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5058074707303475,
      "grad_norm": 0.48986920714378357,
      "learning_rate": 2.1539428678340913e-07,
      "loss": 0.108,
      "mae_dtheta": 0.007328095845878124,
      "mae_dx": 0.0012374755460768938,
      "mae_dy": 0.000941799022257328,
      "pose_mae_dtheta": 0.05305143818259239,
      "pose_mae_dx": 0.01288182195276022,
      "pose_mae_dy": 0.013193486258387566,
      "pose_rmse_dtheta": 0.17274221777915955,
      "pose_rmse_dx": 0.03672494366765022,
      "pose_rmse_dy": 0.03623254969716072,
      "pose_rmse_mean": 0.08189990371465683,
      "rmse_dtheta": 0.021814236417412758,
      "rmse_dx": 0.004115066956728697,
      "rmse_dy": 0.002388408174738288,
      "rmse_mean": 0.009439237415790558,
      "rotation_flip": 0.003126628464087844,
      "sparse_tokens": 32153.0,
      "step": 10887,
      "turn_loss": 0.05295610800385475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5058539304961903,
      "grad_norm": 0.35211822390556335,
      "learning_rate": 2.1501055048105735e-07,
      "loss": 0.0716,
      "mae_dtheta": 0.008816998451948166,
      "mae_dx": 0.002249382669106126,
      "mae_dy": 0.002898325677961111,
      "pose_mae_dtheta": 0.05428759381175041,
      "pose_mae_dx": 0.025828197598457336,
      "pose_mae_dy": 0.031026450917124748,
      "pose_rmse_dtheta": 0.11682813614606857,
      "pose_rmse_dx": 0.07156360149383545,
      "pose_rmse_dy": 0.07594216614961624,
      "pose_rmse_mean": 0.08811130374670029,
      "rmse_dtheta": 0.017819665372371674,
      "rmse_dx": 0.006960226688534021,
      "rmse_dy": 0.006699230056256056,
      "rmse_mean": 0.010493040084838867,
      "rotation_flip": 0.005856515374034643,
      "sparse_tokens": 32105.0,
      "step": 10888,
      "turn_loss": 0.09788604080677032,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29523.0,
      "epoch": 0.505900390262033,
      "grad_norm": 0.6061751842498779,
      "learning_rate": 2.1462714879558587e-07,
      "loss": 0.1889,
      "mae_dtheta": 0.02589498646557331,
      "mae_dx": 0.011423032730817795,
      "mae_dy": 0.005233928561210632,
      "pose_mae_dtheta": 0.1762765496969223,
      "pose_mae_dx": 0.1015048623085022,
      "pose_mae_dy": 0.05785943940281868,
      "pose_rmse_dtheta": 0.33679884672164917,
      "pose_rmse_dx": 0.23966947197914124,
      "pose_rmse_dy": 0.15362803637981415,
      "pose_rmse_mean": 0.24336546659469604,
      "rmse_dtheta": 0.04216333106160164,
      "rmse_dx": 0.024069737643003464,
      "rmse_dy": 0.011854700744152069,
      "rmse_mean": 0.026029257103800774,
      "rotation_flip": 0.024019215255975723,
      "sparse_tokens": 24270.0,
      "step": 10889,
      "turn_loss": 0.24572351574897766,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5059468500278759,
      "grad_norm": 0.3742132782936096,
      "learning_rate": 2.1424408175380662e-07,
      "loss": 0.1035,
      "mae_dtheta": 0.008099623955786228,
      "mae_dx": 0.0016654935898259282,
      "mae_dy": 0.002172572072595358,
      "pose_mae_dtheta": 0.048410989344120026,
      "pose_mae_dx": 0.01935703307390213,
      "pose_mae_dy": 0.02011149190366268,
      "pose_rmse_dtheta": 0.11497445404529572,
      "pose_rmse_dx": 0.05116771534085274,
      "pose_rmse_dy": 0.044452738016843796,
      "pose_rmse_mean": 0.07019830495119095,
      "rmse_dtheta": 0.018466101959347725,
      "rmse_dx": 0.004714288283139467,
      "rmse_dy": 0.0049855392426252365,
      "rmse_mean": 0.009388643316924572,
      "rotation_flip": 0.0060950834304094315,
      "sparse_tokens": 32121.0,
      "step": 10890,
      "turn_loss": 0.07262059301137924,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5059933097937186,
      "grad_norm": 0.4519110321998596,
      "learning_rate": 2.1386134938250645e-07,
      "loss": 0.1272,
      "mae_dtheta": 0.01112042460590601,
      "mae_dx": 0.0013181485701352358,
      "mae_dy": 0.0023839406203478575,
      "pose_mae_dtheta": 0.0760384276509285,
      "pose_mae_dx": 0.01762709766626358,
      "pose_mae_dy": 0.02603236399590969,
      "pose_rmse_dtheta": 0.22120365500450134,
      "pose_rmse_dx": 0.04172869026660919,
      "pose_rmse_dy": 0.061875928193330765,
      "pose_rmse_mean": 0.10826943814754486,
      "rmse_dtheta": 0.025782844051718712,
      "rmse_dx": 0.0035745708737522364,
      "rmse_dy": 0.005454075522720814,
      "rmse_mean": 0.011603830382227898,
      "rotation_flip": 0.00498398020863533,
      "sparse_tokens": 32105.0,
      "step": 10891,
      "turn_loss": 0.09282947331666946,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5060397695595614,
      "grad_norm": 0.4243590235710144,
      "learning_rate": 2.1347895170845233e-07,
      "loss": 0.1069,
      "mae_dtheta": 0.012158648110926151,
      "mae_dx": 0.0014316972810775042,
      "mae_dy": 0.0025230387691408396,
      "pose_mae_dtheta": 0.07567019760608673,
      "pose_mae_dx": 0.02237222157418728,
      "pose_mae_dy": 0.03301322087645531,
      "pose_rmse_dtheta": 0.16625988483428955,
      "pose_rmse_dx": 0.05343518778681755,
      "pose_rmse_dy": 0.06796640902757645,
      "pose_rmse_mean": 0.09588716924190521,
      "rmse_dtheta": 0.02330014295876026,
      "rmse_dx": 0.004590384662151337,
      "rmse_dy": 0.004807103890925646,
      "rmse_mean": 0.010899211280047894,
      "rotation_flip": 0.00695168599486351,
      "sparse_tokens": 32089.0,
      "step": 10892,
      "turn_loss": 0.09006687998771667,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.5060862293254041,
      "grad_norm": 0.8358531594276428,
      "learning_rate": 2.1309688875838286e-07,
      "loss": 0.1663,
      "mae_dtheta": 0.01657225750386715,
      "mae_dx": 0.007199706044048071,
      "mae_dy": 0.00415706355124712,
      "pose_mae_dtheta": 0.1053813025355339,
      "pose_mae_dx": 0.04788770526647568,
      "pose_mae_dy": 0.05041196569800377,
      "pose_rmse_dtheta": 0.19945469498634338,
      "pose_rmse_dx": 0.13751369714736938,
      "pose_rmse_dy": 0.1093258187174797,
      "pose_rmse_mean": 0.1487647444009781,
      "rmse_dtheta": 0.027694785967469215,
      "rmse_dx": 0.019795583561062813,
      "rmse_dy": 0.007235074415802956,
      "rmse_mean": 0.018241815268993378,
      "rotation_flip": 0.0,
      "sparse_tokens": 3095.0,
      "step": 10893,
      "turn_loss": 0.13410907983779907,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.506132689091247,
      "grad_norm": 0.6295311450958252,
      "learning_rate": 2.1271516055901774e-07,
      "loss": 0.1633,
      "mae_dtheta": 0.011955009773373604,
      "mae_dx": 0.0017733887070789933,
      "mae_dy": 0.0022075187880545855,
      "pose_mae_dtheta": 0.07055895030498505,
      "pose_mae_dx": 0.019240092486143112,
      "pose_mae_dy": 0.02244250662624836,
      "pose_rmse_dtheta": 0.17658594250679016,
      "pose_rmse_dx": 0.043787796050310135,
      "pose_rmse_dy": 0.04478380084037781,
      "pose_rmse_mean": 0.08838584274053574,
      "rmse_dtheta": 0.026316650211811066,
      "rmse_dx": 0.004786159377545118,
      "rmse_dy": 0.004595045931637287,
      "rmse_mean": 0.011899285018444061,
      "rotation_flip": 0.008284431882202625,
      "sparse_tokens": 32153.0,
      "step": 10894,
      "turn_loss": 0.0988004058599472,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25637.0,
      "epoch": 0.5061791488570898,
      "grad_norm": 0.6378660202026367,
      "learning_rate": 2.1233376713705179e-07,
      "loss": 0.1399,
      "mae_dtheta": 0.023066429421305656,
      "mae_dx": 0.011346150189638138,
      "mae_dy": 0.004425934981554747,
      "pose_mae_dtheta": 0.16886426508426666,
      "pose_mae_dx": 0.08529277890920639,
      "pose_mae_dy": 0.05404481664299965,
      "pose_rmse_dtheta": 0.3054913878440857,
      "pose_rmse_dx": 0.2091081142425537,
      "pose_rmse_dy": 0.13420188426971436,
      "pose_rmse_mean": 0.21626713871955872,
      "rmse_dtheta": 0.03731939569115639,
      "rmse_dx": 0.023726578801870346,
      "rmse_dy": 0.009322679601609707,
      "rmse_mean": 0.02345621958374977,
      "rotation_flip": 0.007293354719877243,
      "sparse_tokens": 21229.0,
      "step": 10895,
      "turn_loss": 0.2287372201681137,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.5062256086229325,
      "grad_norm": 0.6563403606414795,
      "learning_rate": 2.1195270851915416e-07,
      "loss": 0.1122,
      "mae_dtheta": 0.04135826602578163,
      "mae_dx": 0.012053420767188072,
      "mae_dy": 0.004510846920311451,
      "pose_mae_dtheta": 0.3248792588710785,
      "pose_mae_dx": 0.09754101186990738,
      "pose_mae_dy": 0.06808388978242874,
      "pose_rmse_dtheta": 0.5844660401344299,
      "pose_rmse_dx": 0.22709065675735474,
      "pose_rmse_dy": 0.16800513863563538,
      "pose_rmse_mean": 0.3265206217765808,
      "rmse_dtheta": 0.061936426907777786,
      "rmse_dx": 0.025817304849624634,
      "rmse_dy": 0.008548038080334663,
      "rmse_mean": 0.03210058808326721,
      "rotation_flip": 0.015209125354886055,
      "sparse_tokens": 13954.0,
      "step": 10896,
      "turn_loss": 0.2585452198982239,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5062720683887754,
      "grad_norm": 0.7258933186531067,
      "learning_rate": 2.1157198473197417e-07,
      "loss": 0.1627,
      "mae_dtheta": 0.011808625422418118,
      "mae_dx": 0.002701232209801674,
      "mae_dy": 0.0034684990532696247,
      "pose_mae_dtheta": 0.07982335239648819,
      "pose_mae_dx": 0.024354951456189156,
      "pose_mae_dy": 0.026226315647363663,
      "pose_rmse_dtheta": 0.1879214346408844,
      "pose_rmse_dx": 0.06123390421271324,
      "pose_rmse_dy": 0.06085764989256859,
      "pose_rmse_mean": 0.10333766788244247,
      "rmse_dtheta": 0.024690570309758186,
      "rmse_dx": 0.008013234473764896,
      "rmse_dy": 0.0082897013053298,
      "rmse_mean": 0.013664502650499344,
      "rotation_flip": 0.007528231013566256,
      "sparse_tokens": 32185.0,
      "step": 10897,
      "turn_loss": 0.10846687853336334,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28139.0,
      "epoch": 0.5063185281546181,
      "grad_norm": 0.5848433971405029,
      "learning_rate": 2.111915958021349e-07,
      "loss": 0.1201,
      "mae_dtheta": 0.034367118030786514,
      "mae_dx": 0.012387920171022415,
      "mae_dy": 0.006383147556334734,
      "pose_mae_dtheta": 0.2668013870716095,
      "pose_mae_dx": 0.09886439144611359,
      "pose_mae_dy": 0.07741904258728027,
      "pose_rmse_dtheta": 0.4567013084888458,
      "pose_rmse_dx": 0.2209530919790268,
      "pose_rmse_dy": 0.1690632849931717,
      "pose_rmse_mean": 0.28223922848701477,
      "rmse_dtheta": 0.051448509097099304,
      "rmse_dx": 0.02521882764995098,
      "rmse_dy": 0.01088398415595293,
      "rmse_mean": 0.029183775186538696,
      "rotation_flip": 0.0154440151527524,
      "sparse_tokens": 22341.0,
      "step": 10898,
      "turn_loss": 0.273479163646698,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5063649879204609,
      "grad_norm": 0.44777020812034607,
      "learning_rate": 2.108115417562373e-07,
      "loss": 0.103,
      "mae_dtheta": 0.011009667068719864,
      "mae_dx": 0.0016099385684356093,
      "mae_dy": 0.0023922291584312916,
      "pose_mae_dtheta": 0.06973825395107269,
      "pose_mae_dx": 0.022796638309955597,
      "pose_mae_dy": 0.025946341454982758,
      "pose_rmse_dtheta": 0.18972180783748627,
      "pose_rmse_dx": 0.06587011367082596,
      "pose_rmse_dy": 0.06772380322217941,
      "pose_rmse_mean": 0.10777191817760468,
      "rmse_dtheta": 0.02509772591292858,
      "rmse_dx": 0.004393983632326126,
      "rmse_dy": 0.005605263169854879,
      "rmse_mean": 0.011698991060256958,
      "rotation_flip": 0.004464285913854837,
      "sparse_tokens": 32137.0,
      "step": 10899,
      "turn_loss": 0.09118429571390152,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5064114476863036,
      "grad_norm": 0.41963469982147217,
      "learning_rate": 2.1043182262086015e-07,
      "loss": 0.0808,
      "mae_dtheta": 0.006766265723854303,
      "mae_dx": 0.0013023444917052984,
      "mae_dy": 0.001855362905189395,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.41963469982147217,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.49191284179688,
      "model/head/act_norm_mean": 110.00818734217172,
      "model/head/act_norm_min": 45.204166412353516,
      "model/head/act_over_embed": 75.59865625441685,
      "model/head/grad_frac": 0.09005523473024368,
      "model/head/grad_norm": 0.03779030218720436,
      "model/head/grad_zero_frac": 0.00021479299175553024,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7061040088383839,
      "model/head/update_ratio": 0.0006433040834963322,
      "model/head/weight_delta": 9.979784965515137,
      "model/head/weight_delta_rel": 0.1750749945640564,
      "model/head/weight_norm": 58.744075775146484,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229109287261963,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228498018704928,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227609932422638,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905863426276194,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09893511980772018,
      "model/modality_embedder.encoders.pose/grad_norm": 0.041516609489917755,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5331324236425339,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001340548857115209,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1553900241851807,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10309642553329468,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969860076904297,
      "model/modality_embedder/grad_frac": 0.09893511980772018,
      "model/modality_embedder/grad_norm": 0.041516609489917755,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5331324236425339,
      "model/modality_embedder/update_ratio": 0.001340548857115209,
      "model/modality_embedder/weight_delta": 3.1553900241851807,
      "model/modality_embedder/weight_delta_rel": 0.10309642553329468,
      "model/modality_embedder/weight_norm": 30.969860076904297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.672607421875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.653692179733845,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.972163200378418,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.255038715268277,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.061095353215932846,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.025637730956077576,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009169254335574806,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.739455461502075,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09982740879058838,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960540771484375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.44341278076172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.662265011223344,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.325799942016602,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.948139407475477,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.059226248413324356,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.024853389710187912,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008348556002601981,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4732227325439453,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12031514942646027,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.769685745239258,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.20513153076172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.51738115279782,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.674164772033691,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.22299258783641,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0542694553732872,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.022773345932364464,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00032783247297629714,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007408077945001423,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7627031803131104,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12634453177452087,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.741233825683594,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.87430572509766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.2564734648068,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.457902908325195,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.418113106287727,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.04449333995580673,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.018670950084924698,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006233061430975795,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2341108322143555,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11052656173706055,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954702377319336,
      "model/normalizer/grad_frac": 0.1829301118850708,
      "model/normalizer/grad_norm": 0.0767638236284256,
      "model/normalizer/grad_zero_frac": 0.0002505285374354571,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0009759343229234219,
      "model/normalizer/weight_delta": 6.801877021789551,
      "model/normalizer/weight_delta_rel": 0.08760423958301544,
      "model/normalizer/weight_norm": 78.65675354003906,
      "pose_mae_dtheta": 0.04411185532808304,
      "pose_mae_dx": 0.016525093466043472,
      "pose_mae_dy": 0.019997505471110344,
      "pose_rmse_dtheta": 0.09659640491008759,
      "pose_rmse_dx": 0.05377332866191864,
      "pose_rmse_dy": 0.04911234974861145,
      "pose_rmse_mean": 0.06649403274059296,
      "rmse_dtheta": 0.015138468705117702,
      "rmse_dx": 0.004225300624966621,
      "rmse_dy": 0.004662125371396542,
      "rmse_mean": 0.008008631877601147,
      "rotation_flip": 0.014991181902587414,
      "sparse_tokens": 32089.0,
      "step": 10900,
      "turn_loss": 0.0637950524687767,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5064579074521465,
      "grad_norm": 0.3649938404560089,
      "learning_rate": 2.1005243842255552e-07,
      "loss": 0.0578,
      "mae_dtheta": 0.005587570369243622,
      "mae_dx": 0.0010325456969439983,
      "mae_dy": 0.0008778432966209948,
      "pose_mae_dtheta": 0.03493666276335716,
      "pose_mae_dx": 0.008751656860113144,
      "pose_mae_dy": 0.009636248461902142,
      "pose_rmse_dtheta": 0.13214585185050964,
      "pose_rmse_dx": 0.024451013654470444,
      "pose_rmse_dy": 0.023578334599733353,
      "pose_rmse_mean": 0.06005840003490448,
      "rmse_dtheta": 0.018592581152915955,
      "rmse_dx": 0.003664064919576049,
      "rmse_dy": 0.002161900047212839,
      "rmse_mean": 0.008139515295624733,
      "rotation_flip": 0.005184704903513193,
      "sparse_tokens": 32089.0,
      "step": 10901,
      "turn_loss": 0.04367572441697121,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5065043672179892,
      "grad_norm": 0.4149893820285797,
      "learning_rate": 2.096733891878555e-07,
      "loss": 0.1079,
      "mae_dtheta": 0.005628530401736498,
      "mae_dx": 0.0012083275942131877,
      "mae_dy": 0.0007405205396935344,
      "pose_mae_dtheta": 0.03532768413424492,
      "pose_mae_dx": 0.011796941049396992,
      "pose_mae_dy": 0.010863987728953362,
      "pose_rmse_dtheta": 0.12747862935066223,
      "pose_rmse_dx": 0.028937753289937973,
      "pose_rmse_dy": 0.032385628670454025,
      "pose_rmse_mean": 0.062934011220932,
      "rmse_dtheta": 0.017879735678434372,
      "rmse_dx": 0.0034147577825933695,
      "rmse_dy": 0.0018451636424288154,
      "rmse_mean": 0.007713219150900841,
      "rotation_flip": 0.007242339663207531,
      "sparse_tokens": 32105.0,
      "step": 10902,
      "turn_loss": 0.04749710485339165,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15917.0,
      "epoch": 0.506550826983832,
      "grad_norm": 0.569115400314331,
      "learning_rate": 2.0929467494326616e-07,
      "loss": 0.1478,
      "mae_dtheta": 0.021598918363451958,
      "mae_dx": 0.008084429427981377,
      "mae_dy": 0.003580925753340125,
      "pose_mae_dtheta": 0.16647206246852875,
      "pose_mae_dx": 0.06662549823522568,
      "pose_mae_dy": 0.04190041497349739,
      "pose_rmse_dtheta": 0.31646692752838135,
      "pose_rmse_dx": 0.17730024456977844,
      "pose_rmse_dy": 0.10789337009191513,
      "pose_rmse_mean": 0.2005535215139389,
      "rmse_dtheta": 0.03757711872458458,
      "rmse_dx": 0.019485928118228912,
      "rmse_dy": 0.007742260582745075,
      "rmse_mean": 0.02160177007317543,
      "rotation_flip": 0.015748031437397003,
      "sparse_tokens": 13105.0,
      "step": 10903,
      "turn_loss": 0.14492358267307281,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.5065972867496747,
      "grad_norm": 0.3969331979751587,
      "learning_rate": 2.0891629571527184e-07,
      "loss": 0.0833,
      "mae_dtheta": 0.030501823872327805,
      "mae_dx": 0.010569080710411072,
      "mae_dy": 0.0046533942222595215,
      "pose_mae_dtheta": 0.23046645522117615,
      "pose_mae_dx": 0.07126611471176147,
      "pose_mae_dy": 0.06006794795393944,
      "pose_rmse_dtheta": 0.4313843548297882,
      "pose_rmse_dx": 0.16696657240390778,
      "pose_rmse_dy": 0.14207229018211365,
      "pose_rmse_mean": 0.2468077391386032,
      "rmse_dtheta": 0.04878531023859978,
      "rmse_dx": 0.022715028375387192,
      "rmse_dy": 0.009677954949438572,
      "rmse_mean": 0.027059432119131088,
      "rotation_flip": 0.011463845148682594,
      "sparse_tokens": 22709.0,
      "step": 10904,
      "turn_loss": 0.1914183646440506,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5066437465155176,
      "grad_norm": 0.4738615155220032,
      "learning_rate": 2.085382515303319e-07,
      "loss": 0.0977,
      "mae_dtheta": 0.008070082403719425,
      "mae_dx": 0.0012852562358602881,
      "mae_dy": 0.0016126943519338965,
      "pose_mae_dtheta": 0.051575783640146255,
      "pose_mae_dx": 0.013898290693759918,
      "pose_mae_dy": 0.018213730305433273,
      "pose_rmse_dtheta": 0.1239570900797844,
      "pose_rmse_dx": 0.03611898794770241,
      "pose_rmse_dy": 0.03928862139582634,
      "pose_rmse_mean": 0.06645490229129791,
      "rmse_dtheta": 0.01779019460082054,
      "rmse_dx": 0.004306446295231581,
      "rmse_dy": 0.003317640395835042,
      "rmse_mean": 0.008471427485346794,
      "rotation_flip": 0.004041146021336317,
      "sparse_tokens": 32137.0,
      "step": 10905,
      "turn_loss": 0.05818694829940796,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5066902062813603,
      "grad_norm": 0.4344285726547241,
      "learning_rate": 2.0816054241488358e-07,
      "loss": 0.1156,
      "mae_dtheta": 0.009785789065063,
      "mae_dx": 0.002088007517158985,
      "mae_dy": 0.0019395746057853103,
      "pose_mae_dtheta": 0.06640957295894623,
      "pose_mae_dx": 0.02241806872189045,
      "pose_mae_dy": 0.02779473178088665,
      "pose_rmse_dtheta": 0.15616722404956818,
      "pose_rmse_dx": 0.058022718876600266,
      "pose_rmse_dy": 0.0744825154542923,
      "pose_rmse_mean": 0.09622415155172348,
      "rmse_dtheta": 0.02237989753484726,
      "rmse_dx": 0.00682747270911932,
      "rmse_dy": 0.004568738862872124,
      "rmse_mean": 0.011258704587817192,
      "rotation_flip": 0.0053571430034935474,
      "sparse_tokens": 32057.0,
      "step": 10906,
      "turn_loss": 0.08266610652208328,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.5067366660472031,
      "grad_norm": 1.1190235614776611,
      "learning_rate": 2.077831683953413e-07,
      "loss": 0.2531,
      "mae_dtheta": 0.028763987123966217,
      "mae_dx": 0.013040387071669102,
      "mae_dy": 0.0035007770638912916,
      "pose_mae_dtheta": 0.24124550819396973,
      "pose_mae_dx": 0.11400643736124039,
      "pose_mae_dy": 0.05260074883699417,
      "pose_rmse_dtheta": 0.4624733030796051,
      "pose_rmse_dx": 0.2676756978034973,
      "pose_rmse_dy": 0.1290123015642166,
      "pose_rmse_mean": 0.2863871157169342,
      "rmse_dtheta": 0.04792196676135063,
      "rmse_dx": 0.026944562792778015,
      "rmse_dy": 0.006920309737324715,
      "rmse_mean": 0.027262281626462936,
      "rotation_flip": 0.007497657090425491,
      "sparse_tokens": 19034.0,
      "step": 10907,
      "turn_loss": 0.21375279128551483,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5067831258130459,
      "grad_norm": 0.4752718210220337,
      "learning_rate": 2.0740612949809335e-07,
      "loss": 0.1319,
      "mae_dtheta": 0.00911695696413517,
      "mae_dx": 0.001482048537582159,
      "mae_dy": 0.0025705406442284584,
      "pose_mae_dtheta": 0.0511590912938118,
      "pose_mae_dx": 0.018076403066515923,
      "pose_mae_dy": 0.02629886567592621,
      "pose_rmse_dtheta": 0.10084691643714905,
      "pose_rmse_dx": 0.0453193373978138,
      "pose_rmse_dy": 0.058827802538871765,
      "pose_rmse_mean": 0.06833135336637497,
      "rmse_dtheta": 0.01748310774564743,
      "rmse_dx": 0.003978835418820381,
      "rmse_dy": 0.005383460782468319,
      "rmse_mean": 0.008948467671871185,
      "rotation_flip": 0.006303915288299322,
      "sparse_tokens": 32137.0,
      "step": 10908,
      "turn_loss": 0.08965668827295303,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.5068295855788887,
      "grad_norm": 0.48785218596458435,
      "learning_rate": 2.0702942574950812e-07,
      "loss": 0.1462,
      "mae_dtheta": 0.02523956447839737,
      "mae_dx": 0.00618288479745388,
      "mae_dy": 0.0023723705671727657,
      "pose_mae_dtheta": 0.2019331157207489,
      "pose_mae_dx": 0.04512905329465866,
      "pose_mae_dy": 0.028688926249742508,
      "pose_rmse_dtheta": 0.3429078757762909,
      "pose_rmse_dx": 0.11414118856191635,
      "pose_rmse_dy": 0.07405111938714981,
      "pose_rmse_mean": 0.1770334094762802,
      "rmse_dtheta": 0.0384870320558548,
      "rmse_dx": 0.01549326442182064,
      "rmse_dy": 0.005402617622166872,
      "rmse_mean": 0.01979430578649044,
      "rotation_flip": 0.006116208154708147,
      "sparse_tokens": 5484.0,
      "step": 10909,
      "turn_loss": 0.21412046253681183,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.5068760453447314,
      "grad_norm": 0.4062216877937317,
      "learning_rate": 2.0665305717592677e-07,
      "loss": 0.1011,
      "mae_dtheta": 0.029105497524142265,
      "mae_dx": 0.009667259640991688,
      "mae_dy": 0.00677516357973218,
      "pose_mae_dtheta": 0.2183992713689804,
      "pose_mae_dx": 0.06388653814792633,
      "pose_mae_dy": 0.07233769446611404,
      "pose_rmse_dtheta": 0.409526526927948,
      "pose_rmse_dx": 0.1582135409116745,
      "pose_rmse_dy": 0.17671038210391998,
      "pose_rmse_mean": 0.24815015494823456,
      "rmse_dtheta": 0.047126639634370804,
      "rmse_dx": 0.021431634202599525,
      "rmse_dy": 0.015526441857218742,
      "rmse_mean": 0.02802824042737484,
      "rotation_flip": 0.00918484479188919,
      "sparse_tokens": 17913.0,
      "step": 10910,
      "turn_loss": 0.25770384073257446,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.5069225051105742,
      "grad_norm": 0.49242687225341797,
      "learning_rate": 2.06277023803671e-07,
      "loss": 0.1243,
      "mae_dtheta": 0.02382010594010353,
      "mae_dx": 0.007501739542931318,
      "mae_dy": 0.0033011625055223703,
      "pose_mae_dtheta": 0.19138053059577942,
      "pose_mae_dx": 0.050878286361694336,
      "pose_mae_dy": 0.043496664613485336,
      "pose_rmse_dtheta": 0.3302607834339142,
      "pose_rmse_dx": 0.12578542530536652,
      "pose_rmse_dy": 0.11167789250612259,
      "pose_rmse_mean": 0.18924137949943542,
      "rmse_dtheta": 0.04165812209248543,
      "rmse_dx": 0.019161894917488098,
      "rmse_dy": 0.0065992907620966434,
      "rmse_mean": 0.022473102435469627,
      "rotation_flip": 0.008460236713290215,
      "sparse_tokens": 9875.0,
      "step": 10911,
      "turn_loss": 0.1709958165884018,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5069689648764171,
      "grad_norm": 0.35035377740859985,
      "learning_rate": 2.0590132565903475e-07,
      "loss": 0.1282,
      "mae_dtheta": 0.004226590972393751,
      "mae_dx": 0.0009868454653769732,
      "mae_dy": 0.000678827753290534,
      "pose_mae_dtheta": 0.028463726863265038,
      "pose_mae_dx": 0.008017723448574543,
      "pose_mae_dy": 0.009402992203831673,
      "pose_rmse_dtheta": 0.10222906619310379,
      "pose_rmse_dx": 0.024250298738479614,
      "pose_rmse_dy": 0.026977047324180603,
      "pose_rmse_mean": 0.05115213617682457,
      "rmse_dtheta": 0.01460103690624237,
      "rmse_dx": 0.0031011183746159077,
      "rmse_dy": 0.0020826987456530333,
      "rmse_mean": 0.006594951264560223,
      "rotation_flip": 0.0014873574255034328,
      "sparse_tokens": 32185.0,
      "step": 10912,
      "turn_loss": 0.032262127846479416,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36875.0,
      "epoch": 0.5070154246422598,
      "grad_norm": 0.6644485592842102,
      "learning_rate": 2.055259627682926e-07,
      "loss": 0.1762,
      "mae_dtheta": 0.031216908246278763,
      "mae_dx": 0.013567455112934113,
      "mae_dy": 0.003554531605914235,
      "pose_mae_dtheta": 0.25152671337127686,
      "pose_mae_dx": 0.10534877330064774,
      "pose_mae_dy": 0.04564018175005913,
      "pose_rmse_dtheta": 0.480701208114624,
      "pose_rmse_dx": 0.24578195810317993,
      "pose_rmse_dy": 0.12711898982524872,
      "pose_rmse_mean": 0.2845340669155121,
      "rmse_dtheta": 0.05077775940299034,
      "rmse_dx": 0.0273045152425766,
      "rmse_dy": 0.008012973703444004,
      "rmse_mean": 0.02869841828942299,
      "rotation_flip": 0.006963788531720638,
      "sparse_tokens": 27117.0,
      "step": 10913,
      "turn_loss": 0.2225208282470703,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5070618844081026,
      "grad_norm": 0.38750213384628296,
      "learning_rate": 2.05150935157693e-07,
      "loss": 0.081,
      "mae_dtheta": 0.007016999181360006,
      "mae_dx": 0.0013382676988840103,
      "mae_dy": 0.0012253077002242208,
      "pose_mae_dtheta": 0.04242618754506111,
      "pose_mae_dx": 0.014612206257879734,
      "pose_mae_dy": 0.016278820112347603,
      "pose_rmse_dtheta": 0.11635616421699524,
      "pose_rmse_dx": 0.03771448880434036,
      "pose_rmse_dy": 0.039052966982126236,
      "pose_rmse_mean": 0.06437453627586365,
      "rmse_dtheta": 0.018314624205231667,
      "rmse_dx": 0.0043222056701779366,
      "rmse_dy": 0.0025413574185222387,
      "rmse_mean": 0.008392729796469212,
      "rotation_flip": 0.0014720313483849168,
      "sparse_tokens": 32073.0,
      "step": 10914,
      "turn_loss": 0.05990494042634964,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.5071083441739453,
      "grad_norm": 0.5104033350944519,
      "learning_rate": 2.047762428534622e-07,
      "loss": 0.0865,
      "mae_dtheta": 0.036291226744651794,
      "mae_dx": 0.010902073234319687,
      "mae_dy": 0.005719078704714775,
      "pose_mae_dtheta": 0.2984255850315094,
      "pose_mae_dx": 0.08761132508516312,
      "pose_mae_dy": 0.07078006863594055,
      "pose_rmse_dtheta": 0.5204565525054932,
      "pose_rmse_dx": 0.21563291549682617,
      "pose_rmse_dy": 0.16542227566242218,
      "pose_rmse_mean": 0.3005039095878601,
      "rmse_dtheta": 0.05371379107236862,
      "rmse_dx": 0.023084765300154686,
      "rmse_dy": 0.011207488365471363,
      "rmse_mean": 0.029335349798202515,
      "rotation_flip": 0.01356350164860487,
      "sparse_tokens": 13965.0,
      "step": 10915,
      "turn_loss": 0.25221848487854004,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 21680.0,
      "epoch": 0.5071548039397882,
      "grad_norm": 0.46328723430633545,
      "learning_rate": 2.04401885881802e-07,
      "loss": 0.1357,
      "mae_dtheta": 0.04366203024983406,
      "mae_dx": 0.011002883315086365,
      "mae_dy": 0.003351676743477583,
      "pose_mae_dtheta": 0.3699531555175781,
      "pose_mae_dx": 0.08748485893011093,
      "pose_mae_dy": 0.03825458511710167,
      "pose_rmse_dtheta": 0.5786089301109314,
      "pose_rmse_dx": 0.17866332828998566,
      "pose_rmse_dy": 0.09160108864307404,
      "pose_rmse_mean": 0.2829577922821045,
      "rmse_dtheta": 0.060245342552661896,
      "rmse_dx": 0.020452803000807762,
      "rmse_dy": 0.007831153459846973,
      "rmse_mean": 0.0295097678899765,
      "rotation_flip": 0.013537906110286713,
      "sparse_tokens": 15638.0,
      "step": 10916,
      "turn_loss": 0.3096587359905243,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5072012637056309,
      "grad_norm": 0.5159801840782166,
      "learning_rate": 2.0402786426889309e-07,
      "loss": 0.1168,
      "mae_dtheta": 0.008854949846863747,
      "mae_dx": 0.0013280620332807302,
      "mae_dy": 0.0022965373937040567,
      "pose_mae_dtheta": 0.05968808755278587,
      "pose_mae_dx": 0.018570806831121445,
      "pose_mae_dy": 0.02519289031624794,
      "pose_rmse_dtheta": 0.15748727321624756,
      "pose_rmse_dx": 0.054993510246276855,
      "pose_rmse_dy": 0.05569976195693016,
      "pose_rmse_mean": 0.08939351886510849,
      "rmse_dtheta": 0.020146097987890244,
      "rmse_dx": 0.00372286862693727,
      "rmse_dy": 0.005308929365128279,
      "rmse_mean": 0.009725965559482574,
      "rotation_flip": 0.0034207524731755257,
      "sparse_tokens": 32105.0,
      "step": 10917,
      "turn_loss": 0.07059583067893982,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5072477234714737,
      "grad_norm": 0.3594847321510315,
      "learning_rate": 2.036541780408885e-07,
      "loss": 0.0983,
      "mae_dtheta": 0.005585021339356899,
      "mae_dx": 0.0011078728130087256,
      "mae_dy": 0.001181658823043108,
      "pose_mae_dtheta": 0.036166440695524216,
      "pose_mae_dx": 0.011347660794854164,
      "pose_mae_dy": 0.014126725494861603,
      "pose_rmse_dtheta": 0.07246318459510803,
      "pose_rmse_dx": 0.027051083743572235,
      "pose_rmse_dy": 0.03419011831283569,
      "pose_rmse_mean": 0.04456813260912895,
      "rmse_dtheta": 0.012310308404266834,
      "rmse_dx": 0.003012016648426652,
      "rmse_dy": 0.0026949492748826742,
      "rmse_mean": 0.006005757953971624,
      "rotation_flip": 0.003036876441910863,
      "sparse_tokens": 32121.0,
      "step": 10918,
      "turn_loss": 0.04891235753893852,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.5072941832373165,
      "grad_norm": 0.5349701046943665,
      "learning_rate": 2.0328082722392228e-07,
      "loss": 0.1323,
      "mae_dtheta": 0.03496728837490082,
      "mae_dx": 0.013659805059432983,
      "mae_dy": 0.006771428510546684,
      "pose_mae_dtheta": 0.25436756014823914,
      "pose_mae_dx": 0.12198358029127121,
      "pose_mae_dy": 0.08798583596944809,
      "pose_rmse_dtheta": 0.4179236888885498,
      "pose_rmse_dx": 0.22971832752227783,
      "pose_rmse_dy": 0.18669702112674713,
      "pose_rmse_mean": 0.2781130075454712,
      "rmse_dtheta": 0.051458824425935745,
      "rmse_dx": 0.024790430441498756,
      "rmse_dy": 0.012384524568915367,
      "rmse_mean": 0.029544595628976822,
      "rotation_flip": 0.009661835618317127,
      "sparse_tokens": 7275.0,
      "step": 10919,
      "turn_loss": 0.21807460486888885,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 32438.0,
      "epoch": 0.5073406430031593,
      "grad_norm": 0.4875360429286957,
      "learning_rate": 2.029078118441019e-07,
      "loss": 0.1282,
      "mae_dtheta": 0.030807819217443466,
      "mae_dx": 0.0120030352845788,
      "mae_dy": 0.005111276637762785,
      "pose_mae_dtheta": 0.23476289212703705,
      "pose_mae_dx": 0.09233320504426956,
      "pose_mae_dy": 0.08396969735622406,
      "pose_rmse_dtheta": 0.4370020627975464,
      "pose_rmse_dx": 0.2248149812221527,
      "pose_rmse_dy": 0.19033080339431763,
      "pose_rmse_mean": 0.28404930233955383,
      "rmse_dtheta": 0.04776501655578613,
      "rmse_dx": 0.025898192077875137,
      "rmse_dy": 0.0093722278252244,
      "rmse_mean": 0.0276784785091877,
      "rotation_flip": 0.008633093908429146,
      "sparse_tokens": 26534.0,
      "step": 10920,
      "turn_loss": 0.27434876561164856,
      "turns": 100.0,
      "turns_per_sample": 100.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.507387102769002,
      "grad_norm": 0.7407811284065247,
      "learning_rate": 2.0253513192751374e-07,
      "loss": 0.1839,
      "mae_dtheta": 0.024206925183534622,
      "mae_dx": 0.0039004816208034754,
      "mae_dy": 0.005650725681334734,
      "pose_mae_dtheta": 0.18310479819774628,
      "pose_mae_dx": 0.06279652565717697,
      "pose_mae_dy": 0.07895560562610626,
      "pose_rmse_dtheta": 0.32283255457878113,
      "pose_rmse_dx": 0.13709062337875366,
      "pose_rmse_dy": 0.195057213306427,
      "pose_rmse_mean": 0.21832680702209473,
      "rmse_dtheta": 0.04157741367816925,
      "rmse_dx": 0.009758337400853634,
      "rmse_dy": 0.011260651051998138,
      "rmse_mean": 0.020865468308329582,
      "rotation_flip": 0.02888086624443531,
      "sparse_tokens": 5630.0,
      "step": 10921,
      "turn_loss": 0.18724404275417328,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.5074335625348448,
      "grad_norm": 0.4370652437210083,
      "learning_rate": 2.02162787500218e-07,
      "loss": 0.0844,
      "mae_dtheta": 0.03237362951040268,
      "mae_dx": 0.012045720592141151,
      "mae_dy": 0.003110708901658654,
      "pose_mae_dtheta": 0.24941402673721313,
      "pose_mae_dx": 0.08838868886232376,
      "pose_mae_dy": 0.03373563289642334,
      "pose_rmse_dtheta": 0.45577242970466614,
      "pose_rmse_dx": 0.22703924775123596,
      "pose_rmse_dy": 0.08279214799404144,
      "pose_rmse_mean": 0.2552012801170349,
      "rmse_dtheta": 0.04930427670478821,
      "rmse_dx": 0.025892890989780426,
      "rmse_dy": 0.0058763353154063225,
      "rmse_mean": 0.02702450007200241,
      "rotation_flip": 0.0069084628485143185,
      "sparse_tokens": 10074.0,
      "step": 10922,
      "turn_loss": 0.2720591127872467,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5074800223006876,
      "grad_norm": 0.45135536789894104,
      "learning_rate": 2.0179077858825445e-07,
      "loss": 0.1189,
      "mae_dtheta": 0.011635036207735538,
      "mae_dx": 0.002168562263250351,
      "mae_dy": 0.003041608491912484,
      "pose_mae_dtheta": 0.08057345449924469,
      "pose_mae_dx": 0.027102665975689888,
      "pose_mae_dy": 0.033130086958408356,
      "pose_rmse_dtheta": 0.1869857907295227,
      "pose_rmse_dx": 0.07674489170312881,
      "pose_rmse_dy": 0.07162534445524216,
      "pose_rmse_mean": 0.11178534477949142,
      "rmse_dtheta": 0.02361323870718479,
      "rmse_dx": 0.0074316030368208885,
      "rmse_dy": 0.007135647349059582,
      "rmse_mean": 0.012726830318570137,
      "rotation_flip": 0.006371963303536177,
      "sparse_tokens": 32041.0,
      "step": 10923,
      "turn_loss": 0.1027461364865303,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23042.0,
      "epoch": 0.5075264820665304,
      "grad_norm": 0.5629110932350159,
      "learning_rate": 2.014191052176362e-07,
      "loss": 0.153,
      "mae_dtheta": 0.03669651225209236,
      "mae_dx": 0.007313108537346125,
      "mae_dy": 0.0034554905723780394,
      "pose_mae_dtheta": 0.2897734045982361,
      "pose_mae_dx": 0.057734254747629166,
      "pose_mae_dy": 0.03340966999530792,
      "pose_rmse_dtheta": 0.5447677969932556,
      "pose_rmse_dx": 0.15316256880760193,
      "pose_rmse_dy": 0.08945014327764511,
      "pose_rmse_mean": 0.2624601721763611,
      "rmse_dtheta": 0.057783350348472595,
      "rmse_dx": 0.01774388551712036,
      "rmse_dy": 0.008103188127279282,
      "rmse_mean": 0.027876809239387512,
      "rotation_flip": 0.010551948100328445,
      "sparse_tokens": 16479.0,
      "step": 10924,
      "turn_loss": 0.2888927757740021,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.5075729418323731,
      "grad_norm": 0.5758048295974731,
      "learning_rate": 2.0104776741435572e-07,
      "loss": 0.1587,
      "mae_dtheta": 0.02982606180012226,
      "mae_dx": 0.01172920223325491,
      "mae_dy": 0.0038058441132307053,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5758049488067627,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 143.9895782470703,
      "model/head/act_norm_mean": 101.0426825161638,
      "model/head/act_norm_min": 64.74940490722656,
      "model/head/act_over_embed": 69.43747740160558,
      "model/head/grad_frac": 0.1399451494216919,
      "model/head/grad_norm": 0.08058110624551773,
      "model/head/grad_zero_frac": 0.00012341872206889093,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6970972521551724,
      "model/head/update_ratio": 0.0013717302354052663,
      "model/head/weight_delta": 9.980177879333496,
      "model/head/weight_delta_rel": 0.17508187890052795,
      "model/head/weight_norm": 58.744136810302734,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228498935699463,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228498935699463,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228498935699463,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29058640564434235,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08125308156013489,
      "model/modality_embedder.encoders.pose/grad_norm": 0.046785928308963776,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015106912469491363,
      "model/modality_embedder.encoders.pose/weight_delta": 3.155564785003662,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10310214012861252,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969881057739258,
      "model/modality_embedder/grad_frac": 0.08125308156013489,
      "model/modality_embedder/grad_norm": 0.046785928308963776,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0015106912469491363,
      "model/modality_embedder/weight_delta": 3.155564785003662,
      "model/modality_embedder/weight_delta_rel": 0.10310214012861252,
      "model/modality_embedder/weight_norm": 30.969881057739258,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.0357894897461,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.759163758894363,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.169185638427734,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.640310409760364,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.09621435403823853,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.055400703102350235,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000141220138175413,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0019813862163573503,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7396388053894043,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09983409196138382,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96057891845703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.3652114868164,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.54209214217296,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.596400260925293,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.178346124640424,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09545716643333435,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.054964710026979446,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018463270971551538,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4735026359558105,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12032484263181686,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.769758224487305,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.03086853027344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.110328578270387,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.190253257751465,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.25605288558741,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08298851549625397,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.0477851964533329,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015544294146820903,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7630274295806885,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12635540962219238,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.741310119628906,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 78.69625854492188,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.923027418582375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.052627563476562,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.50175649940373,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07404171675443649,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04263358563184738,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014232663670554757,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2344067096710205,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11053667217493057,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954748153686523,
      "model/normalizer/grad_frac": 0.2889406383037567,
      "model/normalizer/grad_norm": 0.16637344658374786,
      "model/normalizer/grad_zero_frac": 0.00018435118545312434,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002115180715918541,
      "model/normalizer/weight_delta": 6.8024468421936035,
      "model/normalizer/weight_delta_rel": 0.08761157840490341,
      "model/normalizer/weight_norm": 78.65684509277344,
      "pose_mae_dtheta": 0.2534344792366028,
      "pose_mae_dx": 0.09001033008098602,
      "pose_mae_dy": 0.03712313249707222,
      "pose_rmse_dtheta": 0.45695698261260986,
      "pose_rmse_dx": 0.20875000953674316,
      "pose_rmse_dy": 0.08874180912971497,
      "pose_rmse_mean": 0.25148293375968933,
      "rmse_dtheta": 0.04829847440123558,
      "rmse_dx": 0.023545455187559128,
      "rmse_dy": 0.008213000372052193,
      "rmse_mean": 0.026685643941164017,
      "rotation_flip": 0.015531660988926888,
      "sparse_tokens": 15049.0,
      "step": 10925,
      "turn_loss": 0.26558801531791687,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.507619401598216,
      "grad_norm": 0.6711328029632568,
      "learning_rate": 2.0067676520438117e-07,
      "loss": 0.1815,
      "mae_dtheta": 0.03634623438119888,
      "mae_dx": 0.008992353454232216,
      "mae_dy": 0.004914159886538982,
      "pose_mae_dtheta": 0.25845271348953247,
      "pose_mae_dx": 0.07194945216178894,
      "pose_mae_dy": 0.060821447521448135,
      "pose_rmse_dtheta": 0.4300423562526703,
      "pose_rmse_dx": 0.17788301408290863,
      "pose_rmse_dy": 0.15661633014678955,
      "pose_rmse_mean": 0.2548472285270691,
      "rmse_dtheta": 0.05342528596520424,
      "rmse_dx": 0.019819172099232674,
      "rmse_dy": 0.010289885103702545,
      "rmse_mean": 0.027844782918691635,
      "rotation_flip": 0.013550135307013988,
      "sparse_tokens": 12343.0,
      "step": 10926,
      "turn_loss": 0.25927969813346863,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5076658613640588,
      "grad_norm": 0.3648300766944885,
      "learning_rate": 2.0030609861365568e-07,
      "loss": 0.093,
      "mae_dtheta": 0.010296275839209557,
      "mae_dx": 0.001864657737314701,
      "mae_dy": 0.002441412303596735,
      "pose_mae_dtheta": 0.06606459617614746,
      "pose_mae_dx": 0.02191239781677723,
      "pose_mae_dy": 0.029053786769509315,
      "pose_rmse_dtheta": 0.13851740956306458,
      "pose_rmse_dx": 0.056217022240161896,
      "pose_rmse_dy": 0.06508753448724747,
      "pose_rmse_mean": 0.08660732209682465,
      "rmse_dtheta": 0.02085161954164505,
      "rmse_dx": 0.00573976244777441,
      "rmse_dy": 0.0057008289732038975,
      "rmse_mean": 0.010764071717858315,
      "rotation_flip": 0.006264682859182358,
      "sparse_tokens": 32041.0,
      "step": 10927,
      "turn_loss": 0.09413318336009979,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5077123211299015,
      "grad_norm": 0.6641380190849304,
      "learning_rate": 1.9993576766810129e-07,
      "loss": 0.1079,
      "mae_dtheta": 0.008818619884550571,
      "mae_dx": 0.0030460753478109837,
      "mae_dy": 0.0034390694927424192,
      "pose_mae_dtheta": 0.0631832405924797,
      "pose_mae_dx": 0.033646389842033386,
      "pose_mae_dy": 0.03318397328257561,
      "pose_rmse_dtheta": 0.17660187184810638,
      "pose_rmse_dx": 0.07916895300149918,
      "pose_rmse_dy": 0.0846327692270279,
      "pose_rmse_mean": 0.11346787214279175,
      "rmse_dtheta": 0.020630253478884697,
      "rmse_dx": 0.007342763710767031,
      "rmse_dy": 0.008440124802291393,
      "rmse_mean": 0.012137713842093945,
      "rotation_flip": 0.008206811733543873,
      "sparse_tokens": 32153.0,
      "step": 10928,
      "turn_loss": 0.11507344245910645,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5077587808957443,
      "grad_norm": 0.4112880825996399,
      "learning_rate": 1.9956577239361507e-07,
      "loss": 0.0931,
      "mae_dtheta": 0.006117719691246748,
      "mae_dx": 0.0013092989102005959,
      "mae_dy": 0.0012502605095505714,
      "pose_mae_dtheta": 0.03700929507613182,
      "pose_mae_dx": 0.016204943880438805,
      "pose_mae_dy": 0.016677482053637505,
      "pose_rmse_dtheta": 0.0689786747097969,
      "pose_rmse_dx": 0.04551063850522041,
      "pose_rmse_dy": 0.036502059549093246,
      "pose_rmse_mean": 0.05033046007156372,
      "rmse_dtheta": 0.012299722991883755,
      "rmse_dx": 0.004786319099366665,
      "rmse_dy": 0.0024248319678008556,
      "rmse_mean": 0.006503624841570854,
      "rotation_flip": 0.0021312872413545847,
      "sparse_tokens": 32089.0,
      "step": 10929,
      "turn_loss": 0.056658681482076645,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.507805240661587,
      "grad_norm": 0.4058879613876343,
      "learning_rate": 1.9919611281607076e-07,
      "loss": 0.0814,
      "mae_dtheta": 0.008931719698011875,
      "mae_dx": 0.001201100181788206,
      "mae_dy": 0.0016666650772094727,
      "pose_mae_dtheta": 0.061978377401828766,
      "pose_mae_dx": 0.016643928363919258,
      "pose_mae_dy": 0.023856263607740402,
      "pose_rmse_dtheta": 0.1807859241962433,
      "pose_rmse_dx": 0.05214439705014229,
      "pose_rmse_dy": 0.06282011419534683,
      "pose_rmse_mean": 0.09858348220586777,
      "rmse_dtheta": 0.022709086537361145,
      "rmse_dx": 0.004535356070846319,
      "rmse_dy": 0.0037819012068212032,
      "rmse_mean": 0.01034211553633213,
      "rotation_flip": 0.0,
      "sparse_tokens": 32073.0,
      "step": 10930,
      "turn_loss": 0.059134289622306824,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5078517004274299,
      "grad_norm": 0.33787205815315247,
      "learning_rate": 1.988267889613188e-07,
      "loss": 0.0798,
      "mae_dtheta": 0.009965567849576473,
      "mae_dx": 0.002476491266861558,
      "mae_dy": 0.0034763922449201345,
      "pose_mae_dtheta": 0.06795194000005722,
      "pose_mae_dx": 0.029637135565280914,
      "pose_mae_dy": 0.03260340541601181,
      "pose_rmse_dtheta": 0.1382060945034027,
      "pose_rmse_dx": 0.08322487026453018,
      "pose_rmse_dy": 0.07853589206933975,
      "pose_rmse_mean": 0.09998895227909088,
      "rmse_dtheta": 0.019079387187957764,
      "rmse_dx": 0.006806998513638973,
      "rmse_dy": 0.008632471784949303,
      "rmse_mean": 0.011506287381052971,
      "rotation_flip": 0.004978426732122898,
      "sparse_tokens": 32153.0,
      "step": 10931,
      "turn_loss": 0.1032203733921051,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5078981601932726,
      "grad_norm": 0.4877323508262634,
      "learning_rate": 1.9845780085518684e-07,
      "loss": 0.0947,
      "mae_dtheta": 0.013696402311325073,
      "mae_dx": 0.003083139192312956,
      "mae_dy": 0.005123899318277836,
      "pose_mae_dtheta": 0.09794063121080399,
      "pose_mae_dx": 0.03664785251021385,
      "pose_mae_dy": 0.04068823158740997,
      "pose_rmse_dtheta": 0.19758369028568268,
      "pose_rmse_dx": 0.09593275189399719,
      "pose_rmse_dy": 0.08880291879177094,
      "pose_rmse_mean": 0.12743979692459106,
      "rmse_dtheta": 0.025845514610409737,
      "rmse_dx": 0.007338472176343203,
      "rmse_dy": 0.011344090104103088,
      "rmse_mean": 0.014842692762613297,
      "rotation_flip": 0.008672447875142097,
      "sparse_tokens": 32137.0,
      "step": 10932,
      "turn_loss": 0.14515924453735352,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5079446199591154,
      "grad_norm": 0.38417214155197144,
      "learning_rate": 1.9808914852347817e-07,
      "loss": 0.1129,
      "mae_dtheta": 0.010321279056370258,
      "mae_dx": 0.0013511048164218664,
      "mae_dy": 0.0023327511735260487,
      "pose_mae_dtheta": 0.06370829790830612,
      "pose_mae_dx": 0.017842812463641167,
      "pose_mae_dy": 0.02629135735332966,
      "pose_rmse_dtheta": 0.14198845624923706,
      "pose_rmse_dx": 0.04433935508131981,
      "pose_rmse_dy": 0.05384165421128273,
      "pose_rmse_mean": 0.08005648851394653,
      "rmse_dtheta": 0.020649461075663567,
      "rmse_dx": 0.004644583445042372,
      "rmse_dy": 0.0051594325341284275,
      "rmse_mean": 0.010151159018278122,
      "rotation_flip": 0.007554296404123306,
      "sparse_tokens": 32105.0,
      "step": 10933,
      "turn_loss": 0.08803535252809525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.5079910797249582,
      "grad_norm": 0.5058347582817078,
      "learning_rate": 1.977208319919721e-07,
      "loss": 0.0998,
      "mae_dtheta": 0.026610130444169044,
      "mae_dx": 0.01285612303763628,
      "mae_dy": 0.007263101637363434,
      "pose_mae_dtheta": 0.20228052139282227,
      "pose_mae_dx": 0.10424136370420456,
      "pose_mae_dy": 0.10058502852916718,
      "pose_rmse_dtheta": 0.3143150806427002,
      "pose_rmse_dx": 0.24188761413097382,
      "pose_rmse_dy": 0.19791202247142792,
      "pose_rmse_mean": 0.2513715922832489,
      "rmse_dtheta": 0.03867030143737793,
      "rmse_dx": 0.026733163744211197,
      "rmse_dy": 0.012467073276638985,
      "rmse_mean": 0.02595684491097927,
      "rotation_flip": 0.013698630034923553,
      "sparse_tokens": 8314.0,
      "step": 10934,
      "turn_loss": 0.26184001564979553,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 23690.0,
      "epoch": 0.508037539490801,
      "grad_norm": 0.7556655406951904,
      "learning_rate": 1.9735285128642644e-07,
      "loss": 0.1572,
      "mae_dtheta": 0.035279516130685806,
      "mae_dx": 0.010677804239094257,
      "mae_dy": 0.003972628153860569,
      "pose_mae_dtheta": 0.2590680420398712,
      "pose_mae_dx": 0.07515767961740494,
      "pose_mae_dy": 0.0466209314763546,
      "pose_rmse_dtheta": 0.45207974314689636,
      "pose_rmse_dx": 0.17365369200706482,
      "pose_rmse_dy": 0.10827690362930298,
      "pose_rmse_mean": 0.24467012286186218,
      "rmse_dtheta": 0.05203838273882866,
      "rmse_dx": 0.022269465029239655,
      "rmse_dy": 0.007411632686853409,
      "rmse_mean": 0.027239825576543808,
      "rotation_flip": 0.02005012519657612,
      "sparse_tokens": 19799.0,
      "step": 10935,
      "turn_loss": 0.269555926322937,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.5080839992566437,
      "grad_norm": 0.6980500221252441,
      "learning_rate": 1.9698520643257334e-07,
      "loss": 0.2313,
      "mae_dtheta": 0.02510349079966545,
      "mae_dx": 0.00823663268238306,
      "mae_dy": 0.0036890064366161823,
      "pose_mae_dtheta": 0.17265211045742035,
      "pose_mae_dx": 0.07279067486524582,
      "pose_mae_dy": 0.041685983538627625,
      "pose_rmse_dtheta": 0.3379993736743927,
      "pose_rmse_dx": 0.16943852603435516,
      "pose_rmse_dy": 0.09578113257884979,
      "pose_rmse_mean": 0.20107302069664001,
      "rmse_dtheta": 0.041924212127923965,
      "rmse_dx": 0.02017238736152649,
      "rmse_dy": 0.007275647483766079,
      "rmse_mean": 0.023124082013964653,
      "rotation_flip": 0.02414928562939167,
      "sparse_tokens": 16741.0,
      "step": 10936,
      "turn_loss": 0.18167561292648315,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.5081304590224865,
      "grad_norm": 0.4292101562023163,
      "learning_rate": 1.9661789745612226e-07,
      "loss": 0.0718,
      "mae_dtheta": 0.035568416118621826,
      "mae_dx": 0.01077250111848116,
      "mae_dy": 0.0036796201020479202,
      "pose_mae_dtheta": 0.2716001570224762,
      "pose_mae_dx": 0.0937766283750534,
      "pose_mae_dy": 0.0385202094912529,
      "pose_rmse_dtheta": 0.49043190479278564,
      "pose_rmse_dx": 0.20883937180042267,
      "pose_rmse_dy": 0.07928428798913956,
      "pose_rmse_mean": 0.2595185339450836,
      "rmse_dtheta": 0.05577792972326279,
      "rmse_dx": 0.022263402119278908,
      "rmse_dy": 0.006188519764691591,
      "rmse_mean": 0.028076617047190666,
      "rotation_flip": 0.007751937955617905,
      "sparse_tokens": 9006.0,
      "step": 10937,
      "turn_loss": 0.21598796546459198,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5081769187883293,
      "grad_norm": 0.40795084834098816,
      "learning_rate": 1.962509243827604e-07,
      "loss": 0.0756,
      "mae_dtheta": 0.011639656499028206,
      "mae_dx": 0.0024949638172984123,
      "mae_dy": 0.003605866339057684,
      "pose_mae_dtheta": 0.07859330624341965,
      "pose_mae_dx": 0.027888530865311623,
      "pose_mae_dy": 0.030983135104179382,
      "pose_rmse_dtheta": 0.16293884813785553,
      "pose_rmse_dx": 0.0679749846458435,
      "pose_rmse_dy": 0.0702843889594078,
      "pose_rmse_mean": 0.10039940476417542,
      "rmse_dtheta": 0.02315090410411358,
      "rmse_dx": 0.006655990146100521,
      "rmse_dy": 0.007401573937386274,
      "rmse_mean": 0.012402823194861412,
      "rotation_flip": 0.007746933493763208,
      "sparse_tokens": 32137.0,
      "step": 10938,
      "turn_loss": 0.12503457069396973,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.5082233785541721,
      "grad_norm": 0.4793814718723297,
      "learning_rate": 1.9588428723814945e-07,
      "loss": 0.1418,
      "mae_dtheta": 0.040353819727897644,
      "mae_dx": 0.010217871516942978,
      "mae_dy": 0.0030588703230023384,
      "pose_mae_dtheta": 0.3281988501548767,
      "pose_mae_dx": 0.05618695542216301,
      "pose_mae_dy": 0.03559602051973343,
      "pose_rmse_dtheta": 0.577173113822937,
      "pose_rmse_dx": 0.1300414651632309,
      "pose_rmse_dy": 0.09887722134590149,
      "pose_rmse_mean": 0.26869726181030273,
      "rmse_dtheta": 0.06008259579539299,
      "rmse_dx": 0.020498577505350113,
      "rmse_dy": 0.007103314157575369,
      "rmse_mean": 0.02922816388309002,
      "rotation_flip": 0.014354066923260689,
      "sparse_tokens": 3902.0,
      "step": 10939,
      "turn_loss": 0.27278152108192444,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5082698383200148,
      "grad_norm": 0.6927843689918518,
      "learning_rate": 1.9551798604792893e-07,
      "loss": 0.1807,
      "mae_dtheta": 0.008163968101143837,
      "mae_dx": 0.001529682776890695,
      "mae_dy": 0.0023393467999994755,
      "pose_mae_dtheta": 0.051972851157188416,
      "pose_mae_dx": 0.0221685953438282,
      "pose_mae_dy": 0.025545625016093254,
      "pose_rmse_dtheta": 0.10442245006561279,
      "pose_rmse_dx": 0.05788837745785713,
      "pose_rmse_dy": 0.059485532343387604,
      "pose_rmse_mean": 0.07393212616443634,
      "rmse_dtheta": 0.017431849613785744,
      "rmse_dx": 0.004194741602987051,
      "rmse_dy": 0.005152485333383083,
      "rmse_mean": 0.008926359936594963,
      "rotation_flip": 0.0054901959374547005,
      "sparse_tokens": 32089.0,
      "step": 10940,
      "turn_loss": 0.08664485812187195,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4898.0,
      "epoch": 0.5083162980858577,
      "grad_norm": 0.5153484344482422,
      "learning_rate": 1.9515202083771388e-07,
      "loss": 0.1235,
      "mae_dtheta": 0.02720293588936329,
      "mae_dx": 0.007711736485362053,
      "mae_dy": 0.0019784015603363514,
      "pose_mae_dtheta": 0.20800691843032837,
      "pose_mae_dx": 0.06332962960004807,
      "pose_mae_dy": 0.03183673322200775,
      "pose_rmse_dtheta": 0.4573362171649933,
      "pose_rmse_dx": 0.14065779745578766,
      "pose_rmse_dy": 0.0928327813744545,
      "pose_rmse_mean": 0.23027561604976654,
      "rmse_dtheta": 0.05020574852824211,
      "rmse_dx": 0.01809576340019703,
      "rmse_dy": 0.0042295269668102264,
      "rmse_mean": 0.02417701482772827,
      "rotation_flip": 0.0,
      "sparse_tokens": 4214.0,
      "step": 10941,
      "turn_loss": 0.18773560225963593,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.5083627578517004,
      "grad_norm": 0.9485260248184204,
      "learning_rate": 1.9478639163309775e-07,
      "loss": 0.282,
      "mae_dtheta": 0.04853895306587219,
      "mae_dx": 0.009445345029234886,
      "mae_dy": 0.005297916941344738,
      "pose_mae_dtheta": 0.39095038175582886,
      "pose_mae_dx": 0.07764522731304169,
      "pose_mae_dy": 0.053680554032325745,
      "pose_rmse_dtheta": 0.648637592792511,
      "pose_rmse_dx": 0.14755021035671234,
      "pose_rmse_dy": 0.108210988342762,
      "pose_rmse_mean": 0.30146628618240356,
      "rmse_dtheta": 0.06729917228221893,
      "rmse_dx": 0.018436817452311516,
      "rmse_dy": 0.010335708037018776,
      "rmse_mean": 0.032023899257183075,
      "rotation_flip": 0.012345679104328156,
      "sparse_tokens": 9344.0,
      "step": 10942,
      "turn_loss": 0.36453336477279663,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5084092176175432,
      "grad_norm": 0.600804328918457,
      "learning_rate": 1.9442109845964786e-07,
      "loss": 0.1405,
      "mae_dtheta": 0.011888163164258003,
      "mae_dx": 0.0037451088428497314,
      "mae_dy": 0.003942701034247875,
      "pose_mae_dtheta": 0.08448566496372223,
      "pose_mae_dx": 0.03852725401520729,
      "pose_mae_dy": 0.03694814816117287,
      "pose_rmse_dtheta": 0.18483339250087738,
      "pose_rmse_dx": 0.1007746085524559,
      "pose_rmse_dy": 0.09454387426376343,
      "pose_rmse_mean": 0.12671729922294617,
      "rmse_dtheta": 0.02302437461912632,
      "rmse_dx": 0.010471190325915813,
      "rmse_dy": 0.009697703644633293,
      "rmse_mean": 0.014397755265235901,
      "rotation_flip": 0.0034416825510561466,
      "sparse_tokens": 32089.0,
      "step": 10943,
      "turn_loss": 0.14197573065757751,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.508455677383386,
      "grad_norm": 0.3935317397117615,
      "learning_rate": 1.9405614134290984e-07,
      "loss": 0.0833,
      "mae_dtheta": 0.009638052433729172,
      "mae_dx": 0.0018664655508473516,
      "mae_dy": 0.0024073519743978977,
      "pose_mae_dtheta": 0.06497099250555038,
      "pose_mae_dx": 0.019392479211091995,
      "pose_mae_dy": 0.023120058700442314,
      "pose_rmse_dtheta": 0.1694536805152893,
      "pose_rmse_dx": 0.043269190937280655,
      "pose_rmse_dy": 0.04781763255596161,
      "pose_rmse_mean": 0.08684682846069336,
      "rmse_dtheta": 0.02290373481810093,
      "rmse_dx": 0.006330120377242565,
      "rmse_dy": 0.006460167933255434,
      "rmse_mean": 0.011898007243871689,
      "rotation_flip": 0.0049486104398965836,
      "sparse_tokens": 32121.0,
      "step": 10944,
      "turn_loss": 0.07782755047082901,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1017.0,
      "epoch": 0.5085021371492288,
      "grad_norm": 0.5286576151847839,
      "learning_rate": 1.9369152030840553e-07,
      "loss": 0.0885,
      "mae_dtheta": 0.05033383145928383,
      "mae_dx": 0.02990349382162094,
      "mae_dy": 0.016077207401394844,
      "pose_mae_dtheta": 0.44307851791381836,
      "pose_mae_dx": 0.15789109468460083,
      "pose_mae_dy": 0.21198394894599915,
      "pose_rmse_dtheta": 0.7584220767021179,
      "pose_rmse_dx": 0.2405633181333542,
      "pose_rmse_dy": 0.2957093119621277,
      "pose_rmse_mean": 0.43156489729881287,
      "rmse_dtheta": 0.06819837540388107,
      "rmse_dx": 0.04104255884885788,
      "rmse_dy": 0.02019966021180153,
      "rmse_mean": 0.04314686357975006,
      "rotation_flip": 0.017543859779834747,
      "sparse_tokens": 958.0,
      "step": 10945,
      "turn_loss": 0.625952422618866,
      "turns": 3.0,
      "turns_per_sample": 3.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5085485969150716,
      "grad_norm": 0.6200211644172668,
      "learning_rate": 1.933272353816329e-07,
      "loss": 0.1464,
      "mae_dtheta": 0.009043799713253975,
      "mae_dx": 0.0016233049100264907,
      "mae_dy": 0.002459889277815819,
      "pose_mae_dtheta": 0.05713699012994766,
      "pose_mae_dx": 0.018386034294962883,
      "pose_mae_dy": 0.02290613017976284,
      "pose_rmse_dtheta": 0.15932253003120422,
      "pose_rmse_dx": 0.05007025972008705,
      "pose_rmse_dy": 0.05349116399884224,
      "pose_rmse_mean": 0.08762799203395844,
      "rmse_dtheta": 0.021333321928977966,
      "rmse_dx": 0.005970221944153309,
      "rmse_dy": 0.0062838029116392136,
      "rmse_mean": 0.011195781640708447,
      "rotation_flip": 0.00503989914432168,
      "sparse_tokens": 32089.0,
      "step": 10946,
      "turn_loss": 0.08236583322286606,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.5085950566809143,
      "grad_norm": 0.5945644974708557,
      "learning_rate": 1.9296328658806706e-07,
      "loss": 0.1462,
      "mae_dtheta": 0.04524591565132141,
      "mae_dx": 0.014211324974894524,
      "mae_dy": 0.00974871776998043,
      "pose_mae_dtheta": 0.36460644006729126,
      "pose_mae_dx": 0.12242020666599274,
      "pose_mae_dy": 0.10085682570934296,
      "pose_rmse_dtheta": 0.6067783236503601,
      "pose_rmse_dx": 0.27264413237571716,
      "pose_rmse_dy": 0.21660469472408295,
      "pose_rmse_mean": 0.365342378616333,
      "rmse_dtheta": 0.064475879073143,
      "rmse_dx": 0.027930190786719322,
      "rmse_dy": 0.01990571618080139,
      "rmse_mean": 0.03743726387619972,
      "rotation_flip": 0.021718602627515793,
      "sparse_tokens": 16040.0,
      "step": 10947,
      "turn_loss": 0.4234972298145294,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5086415164467571,
      "grad_norm": 0.5176258683204651,
      "learning_rate": 1.925996739531577e-07,
      "loss": 0.1137,
      "mae_dtheta": 0.005849070381373167,
      "mae_dx": 0.001137151732109487,
      "mae_dy": 0.0015178878093138337,
      "pose_mae_dtheta": 0.03674008324742317,
      "pose_mae_dx": 0.014350209385156631,
      "pose_mae_dy": 0.017323970794677734,
      "pose_rmse_dtheta": 0.08085989207029343,
      "pose_rmse_dx": 0.037101972848176956,
      "pose_rmse_dy": 0.04231663793325424,
      "pose_rmse_mean": 0.053426168859004974,
      "rmse_dtheta": 0.014527990482747555,
      "rmse_dx": 0.0030518649145960808,
      "rmse_dy": 0.003487237496301532,
      "rmse_mean": 0.007022364065051079,
      "rotation_flip": 0.002354048890992999,
      "sparse_tokens": 32089.0,
      "step": 10948,
      "turn_loss": 0.05342669039964676,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.5086879762125999,
      "grad_norm": 0.5359250903129578,
      "learning_rate": 1.9223639750233446e-07,
      "loss": 0.0972,
      "mae_dtheta": 0.02870294637978077,
      "mae_dx": 0.010272786021232605,
      "mae_dy": 0.006631356664001942,
      "pose_mae_dtheta": 0.20979544520378113,
      "pose_mae_dx": 0.08751847594976425,
      "pose_mae_dy": 0.06487692147493362,
      "pose_rmse_dtheta": 0.3439302444458008,
      "pose_rmse_dx": 0.17929339408874512,
      "pose_rmse_dy": 0.1352805644273758,
      "pose_rmse_mean": 0.21950140595436096,
      "rmse_dtheta": 0.04297391697764397,
      "rmse_dx": 0.02094551920890808,
      "rmse_dy": 0.013604977168142796,
      "rmse_mean": 0.025841472670435905,
      "rotation_flip": 0.011283498257398605,
      "sparse_tokens": 11247.0,
      "step": 10949,
      "turn_loss": 0.3071275055408478,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 12351.0,
      "epoch": 0.5087344359784427,
      "grad_norm": 0.5024315714836121,
      "learning_rate": 1.918734572609998e-07,
      "loss": 0.1108,
      "mae_dtheta": 0.033388640731573105,
      "mae_dx": 0.011502952314913273,
      "mae_dy": 0.00490995217114687,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5024314522743225,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.03684997558594,
      "model/head/act_norm_mean": 103.56175472861842,
      "model/head/act_norm_min": 60.59782409667969,
      "model/head/act_over_embed": 71.16860740993002,
      "model/head/grad_frac": 0.10171418637037277,
      "model/head/grad_norm": 0.051104407757520676,
      "model/head/grad_zero_frac": 0.00021130300592631102,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6895045230263158,
      "model/head/update_ratio": 0.0008699483587406576,
      "model/head/weight_delta": 9.980572700500488,
      "model/head/weight_delta_rel": 0.1750888079404831,
      "model/head/weight_norm": 58.74418640136719,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228835999965668,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228487748366136,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228036403656006,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29058563684032235,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1363045573234558,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06848369538784027,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.529296875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0022112985607236624,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1555492877960205,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10310163348913193,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969900131225586,
      "model/modality_embedder/grad_frac": 0.1363045573234558,
      "model/modality_embedder/grad_norm": 0.06848369538784027,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.529296875,
      "model/modality_embedder/update_ratio": 0.0022112985607236624,
      "model/modality_embedder/weight_delta": 3.1555492877960205,
      "model/modality_embedder/weight_delta_rel": 0.10310163348913193,
      "model/modality_embedder/weight_norm": 30.969900131225586,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.0082778930664,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.969441833751045,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.324872016906738,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.784815471456229,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.062229473143815994,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.031266044825315475,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0011182165471836925,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.73988938331604,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09984321892261505,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960634231567383,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.47515106201172,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.78740634137427,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.892170906066895,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.34692833899928,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05988863855600357,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030089935287833214,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001010752166621387,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4737956523895264,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12033499777317047,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76984405517578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 79.93013000488281,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.411721034356724,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.217936515808105,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.46317260309057,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06152158975601196,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03091038204729557,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010054964805021882,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.763375997543335,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12636712193489075,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.741413116455078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 80.59209442138672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.24831283939014,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.940286636352539,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.72529568595292,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05569965019822121,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.027985256165266037,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009342497796751559,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.234722375869751,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11054746061563492,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954790115356445,
      "model/normalizer/grad_frac": 0.2253745198249817,
      "model/normalizer/grad_norm": 0.11323525011539459,
      "model/normalizer/grad_zero_frac": 0.0002836172061506659,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014396094484254718,
      "model/normalizer/weight_delta": 6.8030686378479,
      "model/normalizer/weight_delta_rel": 0.0876195877790451,
      "model/normalizer/weight_norm": 78.65692138671875,
      "pose_mae_dtheta": 0.2375321090221405,
      "pose_mae_dx": 0.09090922772884369,
      "pose_mae_dy": 0.05036689713597298,
      "pose_rmse_dtheta": 0.3876495361328125,
      "pose_rmse_dx": 0.1871793270111084,
      "pose_rmse_dy": 0.11642877012491226,
      "pose_rmse_mean": 0.23041921854019165,
      "rmse_dtheta": 0.05058993026614189,
      "rmse_dx": 0.023362796753644943,
      "rmse_dy": 0.008856897242367268,
      "rmse_mean": 0.027603209018707275,
      "rotation_flip": 0.019264448434114456,
      "sparse_tokens": 9477.0,
      "step": 10950,
      "turn_loss": 0.28046342730522156,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.5087808957442854,
      "grad_norm": 0.6375628709793091,
      "learning_rate": 1.9151085325453512e-07,
      "loss": 0.1503,
      "mae_dtheta": 0.00705677131190896,
      "mae_dx": 0.0010530315339565277,
      "mae_dy": 0.00021072810341138393,
      "pose_mae_dtheta": 0.04866814240813255,
      "pose_mae_dx": 0.00807972252368927,
      "pose_mae_dy": 0.0029511142056435347,
      "pose_rmse_dtheta": 0.22713863849639893,
      "pose_rmse_dx": 0.01746976375579834,
      "pose_rmse_dy": 0.00843212753534317,
      "pose_rmse_mean": 0.08434684574604034,
      "rmse_dtheta": 0.028400765731930733,
      "rmse_dx": 0.002748201135545969,
      "rmse_dy": 0.00045733104343526065,
      "rmse_mean": 0.01053543295711279,
      "rotation_flip": 0.0,
      "sparse_tokens": 32201.0,
      "step": 10951,
      "turn_loss": 0.03979060798883438,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5088273555101283,
      "grad_norm": 0.39574581384658813,
      "learning_rate": 1.911485855082973e-07,
      "loss": 0.1055,
      "mae_dtheta": 0.01674562320113182,
      "mae_dx": 0.002876431215554476,
      "mae_dy": 0.005010975990444422,
      "pose_mae_dtheta": 0.109809011220932,
      "pose_mae_dx": 0.035665079951286316,
      "pose_mae_dy": 0.04266754910349846,
      "pose_rmse_dtheta": 0.2354823797941208,
      "pose_rmse_dx": 0.09165965765714645,
      "pose_rmse_dy": 0.08926668018102646,
      "pose_rmse_mean": 0.1388029158115387,
      "rmse_dtheta": 0.031186886131763458,
      "rmse_dx": 0.007400088477879763,
      "rmse_dy": 0.01034705713391304,
      "rmse_mean": 0.016311343759298325,
      "rotation_flip": 0.006561679765582085,
      "sparse_tokens": 32105.0,
      "step": 10952,
      "turn_loss": 0.156515434384346,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22648.0,
      "epoch": 0.508873815275971,
      "grad_norm": 0.4220770299434662,
      "learning_rate": 1.9078665404762053e-07,
      "loss": 0.0973,
      "mae_dtheta": 0.03677729517221451,
      "mae_dx": 0.013940068893134594,
      "mae_dy": 0.0059813703410327435,
      "pose_mae_dtheta": 0.2676726281642914,
      "pose_mae_dx": 0.10656718909740448,
      "pose_mae_dy": 0.07729871571063995,
      "pose_rmse_dtheta": 0.4876980483531952,
      "pose_rmse_dx": 0.23638606071472168,
      "pose_rmse_dy": 0.1877899318933487,
      "pose_rmse_mean": 0.3039580285549164,
      "rmse_dtheta": 0.05530567467212677,
      "rmse_dx": 0.027206167578697205,
      "rmse_dy": 0.012866776436567307,
      "rmse_mean": 0.03179287537932396,
      "rotation_flip": 0.012229539453983307,
      "sparse_tokens": 18203.0,
      "step": 10953,
      "turn_loss": 0.31471526622772217,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.5089202750418138,
      "grad_norm": 0.6596643924713135,
      "learning_rate": 1.9042505889781348e-07,
      "loss": 0.1447,
      "mae_dtheta": 0.03852050378918648,
      "mae_dx": 0.008026741445064545,
      "mae_dy": 0.00836506299674511,
      "pose_mae_dtheta": 0.3150040805339813,
      "pose_mae_dx": 0.09182289242744446,
      "pose_mae_dy": 0.07022962719202042,
      "pose_rmse_dtheta": 0.5263916850090027,
      "pose_rmse_dx": 0.19175952672958374,
      "pose_rmse_dy": 0.18978509306907654,
      "pose_rmse_mean": 0.3026454448699951,
      "rmse_dtheta": 0.060572464019060135,
      "rmse_dx": 0.016722017899155617,
      "rmse_dy": 0.020510347560048103,
      "rmse_mean": 0.03260160982608795,
      "rotation_flip": 0.006289307959377766,
      "sparse_tokens": 7547.0,
      "step": 10954,
      "turn_loss": 0.4025229811668396,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.5089667348076565,
      "grad_norm": 0.477295845746994,
      "learning_rate": 1.900638000841637e-07,
      "loss": 0.1291,
      "mae_dtheta": 0.016963453963398933,
      "mae_dx": 0.005915562156587839,
      "mae_dy": 0.003245452418923378,
      "pose_mae_dtheta": 0.11417792737483978,
      "pose_mae_dx": 0.04494267702102661,
      "pose_mae_dy": 0.031693968921899796,
      "pose_rmse_dtheta": 0.20730078220367432,
      "pose_rmse_dx": 0.09991083294153214,
      "pose_rmse_dy": 0.08093660324811935,
      "pose_rmse_mean": 0.12938274443149567,
      "rmse_dtheta": 0.0301186703145504,
      "rmse_dx": 0.01406601257622242,
      "rmse_dy": 0.006512477528303862,
      "rmse_mean": 0.016899054870009422,
      "rotation_flip": 0.014652014710009098,
      "sparse_tokens": 9819.0,
      "step": 10955,
      "turn_loss": 0.17300653457641602,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.5090131945734994,
      "grad_norm": 0.5334916114807129,
      "learning_rate": 1.897028776319343e-07,
      "loss": 0.1299,
      "mae_dtheta": 0.03643709793686867,
      "mae_dx": 0.013552057556807995,
      "mae_dy": 0.0040393793024122715,
      "pose_mae_dtheta": 0.26060977578163147,
      "pose_mae_dx": 0.10559828579425812,
      "pose_mae_dy": 0.04724813252687454,
      "pose_rmse_dtheta": 0.4640888273715973,
      "pose_rmse_dx": 0.22352485358715057,
      "pose_rmse_dy": 0.13404235243797302,
      "pose_rmse_mean": 0.2738853394985199,
      "rmse_dtheta": 0.05670823156833649,
      "rmse_dx": 0.02655518613755703,
      "rmse_dy": 0.009345349855720997,
      "rmse_mean": 0.03086959198117256,
      "rotation_flip": 0.017789073288440704,
      "sparse_tokens": 13886.0,
      "step": 10956,
      "turn_loss": 0.2470512092113495,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.5090596543393421,
      "grad_norm": 0.49764129519462585,
      "learning_rate": 1.8934229156636453e-07,
      "loss": 0.1118,
      "mae_dtheta": 0.02992125414311886,
      "mae_dx": 0.009373973123729229,
      "mae_dy": 0.004515378270298243,
      "pose_mae_dtheta": 0.23047026991844177,
      "pose_mae_dx": 0.06936290115118027,
      "pose_mae_dy": 0.05880393460392952,
      "pose_rmse_dtheta": 0.45560356974601746,
      "pose_rmse_dx": 0.168909952044487,
      "pose_rmse_dy": 0.13781601190567017,
      "pose_rmse_mean": 0.25410985946655273,
      "rmse_dtheta": 0.05035622417926788,
      "rmse_dx": 0.021552661433815956,
      "rmse_dy": 0.008432015776634216,
      "rmse_mean": 0.026780299842357635,
      "rotation_flip": 0.009523809887468815,
      "sparse_tokens": 13073.0,
      "step": 10957,
      "turn_loss": 0.22943797707557678,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5091061141051849,
      "grad_norm": 0.35571590065956116,
      "learning_rate": 1.8898204191266978e-07,
      "loss": 0.1054,
      "mae_dtheta": 0.008143141865730286,
      "mae_dx": 0.0013027690583840013,
      "mae_dy": 0.0018369180615991354,
      "pose_mae_dtheta": 0.05042222887277603,
      "pose_mae_dx": 0.015526189468801022,
      "pose_mae_dy": 0.021835705265402794,
      "pose_rmse_dtheta": 0.12234927713871002,
      "pose_rmse_dx": 0.04127825051546097,
      "pose_rmse_dy": 0.05921487882733345,
      "pose_rmse_mean": 0.07428080588579178,
      "rmse_dtheta": 0.01804744452238083,
      "rmse_dx": 0.003964558243751526,
      "rmse_dy": 0.003992587793618441,
      "rmse_mean": 0.008668197318911552,
      "rotation_flip": 0.004369992762804031,
      "sparse_tokens": 32137.0,
      "step": 10958,
      "turn_loss": 0.06494166702032089,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.5091525738710276,
      "grad_norm": 0.5187160968780518,
      "learning_rate": 1.8862212869604379e-07,
      "loss": 0.1721,
      "mae_dtheta": 0.02442537434399128,
      "mae_dx": 0.010638317093253136,
      "mae_dy": 0.003940058406442404,
      "pose_mae_dtheta": 0.19782982766628265,
      "pose_mae_dx": 0.08915044367313385,
      "pose_mae_dy": 0.05426323786377907,
      "pose_rmse_dtheta": 0.40000030398368835,
      "pose_rmse_dx": 0.2389577180147171,
      "pose_rmse_dy": 0.10680887848138809,
      "pose_rmse_mean": 0.24858897924423218,
      "rmse_dtheta": 0.043006278574466705,
      "rmse_dx": 0.02436840906739235,
      "rmse_dy": 0.006450759246945381,
      "rmse_mean": 0.024608483538031578,
      "rotation_flip": 0.01764705963432789,
      "sparse_tokens": 6080.0,
      "step": 10959,
      "turn_loss": 0.1630474179983139,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.5091990336368705,
      "grad_norm": 0.7917651534080505,
      "learning_rate": 1.882625519416542e-07,
      "loss": 0.1377,
      "mae_dtheta": 0.03069128841161728,
      "mae_dx": 0.009383905678987503,
      "mae_dy": 0.0059104133397340775,
      "pose_mae_dtheta": 0.21751368045806885,
      "pose_mae_dx": 0.079286590218544,
      "pose_mae_dy": 0.07321389019489288,
      "pose_rmse_dtheta": 0.3965611457824707,
      "pose_rmse_dx": 0.14776049554347992,
      "pose_rmse_dy": 0.17851480841636658,
      "pose_rmse_mean": 0.240945503115654,
      "rmse_dtheta": 0.04855726286768913,
      "rmse_dx": 0.019764933735132217,
      "rmse_dy": 0.011336887255311012,
      "rmse_mean": 0.02655302733182907,
      "rotation_flip": 0.016036655753850937,
      "sparse_tokens": 16031.0,
      "step": 10960,
      "turn_loss": 0.23757177591323853,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 35578.0,
      "epoch": 0.5092454934027133,
      "grad_norm": 0.6468927264213562,
      "learning_rate": 1.8790331167464758e-07,
      "loss": 0.1785,
      "mae_dtheta": 0.03618805482983589,
      "mae_dx": 0.011888142675161362,
      "mae_dy": 0.005486119072884321,
      "pose_mae_dtheta": 0.29677000641822815,
      "pose_mae_dx": 0.10277745127677917,
      "pose_mae_dy": 0.05904828757047653,
      "pose_rmse_dtheta": 0.5140197277069092,
      "pose_rmse_dx": 0.2228468507528305,
      "pose_rmse_dy": 0.14685209095478058,
      "pose_rmse_mean": 0.2945728898048401,
      "rmse_dtheta": 0.053550831973552704,
      "rmse_dx": 0.023802779614925385,
      "rmse_dy": 0.012325992807745934,
      "rmse_mean": 0.02989320270717144,
      "rotation_flip": 0.01390498224645853,
      "sparse_tokens": 27518.0,
      "step": 10961,
      "turn_loss": 0.30306899547576904,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.509291953168556,
      "grad_norm": 0.6095865368843079,
      "learning_rate": 1.8754440792014494e-07,
      "loss": 0.1541,
      "mae_dtheta": 0.03056311048567295,
      "mae_dx": 0.008299468085169792,
      "mae_dy": 0.006407936569303274,
      "pose_mae_dtheta": 0.22314320504665375,
      "pose_mae_dx": 0.0602327361702919,
      "pose_mae_dy": 0.0633687674999237,
      "pose_rmse_dtheta": 0.4303134083747864,
      "pose_rmse_dx": 0.20315073430538177,
      "pose_rmse_dy": 0.20464742183685303,
      "pose_rmse_mean": 0.2793705463409424,
      "rmse_dtheta": 0.05032149329781532,
      "rmse_dx": 0.019382093101739883,
      "rmse_dy": 0.01828187331557274,
      "rmse_mean": 0.0293284859508276,
      "rotation_flip": 0.00968188140541315,
      "sparse_tokens": 12339.0,
      "step": 10962,
      "turn_loss": 0.2407189905643463,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5093384129343989,
      "grad_norm": 0.4681873023509979,
      "learning_rate": 1.8718584070324452e-07,
      "loss": 0.1046,
      "mae_dtheta": 0.006875380873680115,
      "mae_dx": 0.0009256608900614083,
      "mae_dy": 0.0013994352193549275,
      "pose_mae_dtheta": 0.04148387908935547,
      "pose_mae_dx": 0.013010055758059025,
      "pose_mae_dy": 0.01864420622587204,
      "pose_rmse_dtheta": 0.10798329859972,
      "pose_rmse_dx": 0.03181303292512894,
      "pose_rmse_dy": 0.04175887256860733,
      "pose_rmse_mean": 0.060518406331539154,
      "rmse_dtheta": 0.015941832214593887,
      "rmse_dx": 0.00300855771638453,
      "rmse_dy": 0.002882343716919422,
      "rmse_mean": 0.007277578115463257,
      "rotation_flip": 0.0012642225483432412,
      "sparse_tokens": 32089.0,
      "step": 10963,
      "turn_loss": 0.05498397722840309,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5093848727002416,
      "grad_norm": 0.3424680233001709,
      "learning_rate": 1.8682761004902185e-07,
      "loss": 0.0927,
      "mae_dtheta": 0.010724003426730633,
      "mae_dx": 0.0026918924413621426,
      "mae_dy": 0.0028125422541052103,
      "pose_mae_dtheta": 0.0725526213645935,
      "pose_mae_dx": 0.03144420310854912,
      "pose_mae_dy": 0.028352107852697372,
      "pose_rmse_dtheta": 0.22586537897586823,
      "pose_rmse_dx": 0.09202178567647934,
      "pose_rmse_dy": 0.07853586971759796,
      "pose_rmse_mean": 0.13214102387428284,
      "rmse_dtheta": 0.027034979313611984,
      "rmse_dx": 0.008002017624676228,
      "rmse_dy": 0.007503737695515156,
      "rmse_mean": 0.014180244877934456,
      "rotation_flip": 0.004604436922818422,
      "sparse_tokens": 32121.0,
      "step": 10964,
      "turn_loss": 0.10508786886930466,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5094313324660844,
      "grad_norm": 0.3878728449344635,
      "learning_rate": 1.8646971598252738e-07,
      "loss": 0.1049,
      "mae_dtheta": 0.008439340628683567,
      "mae_dx": 0.001970329089090228,
      "mae_dy": 0.0024495304096490145,
      "pose_mae_dtheta": 0.054055191576480865,
      "pose_mae_dx": 0.019814327359199524,
      "pose_mae_dy": 0.02402920089662075,
      "pose_rmse_dtheta": 0.11499294638633728,
      "pose_rmse_dx": 0.048548247665166855,
      "pose_rmse_dy": 0.05238158628344536,
      "pose_rmse_mean": 0.0719742625951767,
      "rmse_dtheta": 0.01745189167559147,
      "rmse_dx": 0.005446309223771095,
      "rmse_dy": 0.004998188465833664,
      "rmse_mean": 0.009298796765506268,
      "rotation_flip": 0.0030395137146115303,
      "sparse_tokens": 32105.0,
      "step": 10965,
      "turn_loss": 0.07857386022806168,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.5094777922319271,
      "grad_norm": 1.1814676523208618,
      "learning_rate": 1.8611215852879005e-07,
      "loss": 0.2617,
      "mae_dtheta": 0.037479788064956665,
      "mae_dx": 0.01120947115123272,
      "mae_dy": 0.004680299665778875,
      "pose_mae_dtheta": 0.3044517934322357,
      "pose_mae_dx": 0.08372532576322556,
      "pose_mae_dy": 0.047688789665699005,
      "pose_rmse_dtheta": 0.5413385033607483,
      "pose_rmse_dx": 0.18510106205940247,
      "pose_rmse_dy": 0.11918580532073975,
      "pose_rmse_mean": 0.2818751335144043,
      "rmse_dtheta": 0.05829187110066414,
      "rmse_dx": 0.02195262908935547,
      "rmse_dy": 0.012046977877616882,
      "rmse_mean": 0.03076382540166378,
      "rotation_flip": 0.013278855942189693,
      "sparse_tokens": 16426.0,
      "step": 10966,
      "turn_loss": 0.29912352561950684,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.50952425199777,
      "grad_norm": 1.2812260389328003,
      "learning_rate": 1.8575493771281205e-07,
      "loss": 0.2561,
      "mae_dtheta": 0.03592785447835922,
      "mae_dx": 0.008092660456895828,
      "mae_dy": 0.00407740892842412,
      "pose_mae_dtheta": 0.2643040120601654,
      "pose_mae_dx": 0.06679706275463104,
      "pose_mae_dy": 0.026402082294225693,
      "pose_rmse_dtheta": 0.45221462845802307,
      "pose_rmse_dx": 0.15290185809135437,
      "pose_rmse_dy": 0.06093749403953552,
      "pose_rmse_mean": 0.22201800346374512,
      "rmse_dtheta": 0.0554484948515892,
      "rmse_dx": 0.018248533830046654,
      "rmse_dy": 0.00903503131121397,
      "rmse_mean": 0.0275773536413908,
      "rotation_flip": 0.016293279826641083,
      "sparse_tokens": 7700.0,
      "step": 10967,
      "turn_loss": 0.26979902386665344,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5095707117636127,
      "grad_norm": 0.7197288274765015,
      "learning_rate": 1.8539805355957618e-07,
      "loss": 0.133,
      "mae_dtheta": 0.008220728486776352,
      "mae_dx": 0.0013294098898768425,
      "mae_dy": 0.0016216704389080405,
      "pose_mae_dtheta": 0.05738106369972229,
      "pose_mae_dx": 0.018622104078531265,
      "pose_mae_dy": 0.021496498957276344,
      "pose_rmse_dtheta": 0.17318286001682281,
      "pose_rmse_dx": 0.050149910151958466,
      "pose_rmse_dy": 0.05786314606666565,
      "pose_rmse_mean": 0.09373196959495544,
      "rmse_dtheta": 0.021457377821207047,
      "rmse_dx": 0.004201844334602356,
      "rmse_dy": 0.004316728562116623,
      "rmse_mean": 0.009991983883082867,
      "rotation_flip": 0.0013009540271013975,
      "sparse_tokens": 32089.0,
      "step": 10968,
      "turn_loss": 0.05334467813372612,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5096171715294555,
      "grad_norm": 0.5295688509941101,
      "learning_rate": 1.8504150609403858e-07,
      "loss": 0.1487,
      "mae_dtheta": 0.006341641768813133,
      "mae_dx": 0.0015086607309058309,
      "mae_dy": 0.0018446454778313637,
      "pose_mae_dtheta": 0.04516293853521347,
      "pose_mae_dx": 0.011522256769239902,
      "pose_mae_dy": 0.013220192864537239,
      "pose_rmse_dtheta": 0.1419774442911148,
      "pose_rmse_dx": 0.03180975466966629,
      "pose_rmse_dy": 0.03547082468867302,
      "pose_rmse_mean": 0.06975267827510834,
      "rmse_dtheta": 0.01941874250769615,
      "rmse_dx": 0.005753911565989256,
      "rmse_dy": 0.007012033369392157,
      "rmse_mean": 0.010728228837251663,
      "rotation_flip": 0.004306219983845949,
      "sparse_tokens": 32137.0,
      "step": 10969,
      "turn_loss": 0.056506093591451645,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5096636312952982,
      "grad_norm": 0.3425227105617523,
      "learning_rate": 1.8468529534113212e-07,
      "loss": 0.0824,
      "mae_dtheta": 0.004957882687449455,
      "mae_dx": 0.0009317944059148431,
      "mae_dy": 0.0007224669097922742,
      "pose_mae_dtheta": 0.03231026232242584,
      "pose_mae_dx": 0.007778537459671497,
      "pose_mae_dy": 0.009970007464289665,
      "pose_rmse_dtheta": 0.10725924372673035,
      "pose_rmse_dx": 0.01735476404428482,
      "pose_rmse_dy": 0.025043856352567673,
      "pose_rmse_mean": 0.04988595470786095,
      "rmse_dtheta": 0.01729772612452507,
      "rmse_dx": 0.0028642616234719753,
      "rmse_dy": 0.0018201752100139856,
      "rmse_mean": 0.0073273880407214165,
      "rotation_flip": 0.0023463163524866104,
      "sparse_tokens": 32169.0,
      "step": 10970,
      "turn_loss": 0.041653405874967575,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5097100910611411,
      "grad_norm": 0.4850556254386902,
      "learning_rate": 1.8432942132576792e-07,
      "loss": 0.1233,
      "mae_dtheta": 0.008571618236601353,
      "mae_dx": 0.0018903639866039157,
      "mae_dy": 0.0015840253327041864,
      "pose_mae_dtheta": 0.054324451833963394,
      "pose_mae_dx": 0.01583450473845005,
      "pose_mae_dy": 0.01702667400240898,
      "pose_rmse_dtheta": 0.16639123857021332,
      "pose_rmse_dx": 0.044616855680942535,
      "pose_rmse_dy": 0.049694281071424484,
      "pose_rmse_mean": 0.08690079301595688,
      "rmse_dtheta": 0.022938968613743782,
      "rmse_dx": 0.006651713978499174,
      "rmse_dy": 0.0039142584428191185,
      "rmse_mean": 0.011168314144015312,
      "rotation_flip": 0.0034158837515860796,
      "sparse_tokens": 32137.0,
      "step": 10971,
      "turn_loss": 0.07409606128931046,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5097565508269838,
      "grad_norm": 0.35835886001586914,
      "learning_rate": 1.8397388407283224e-07,
      "loss": 0.1002,
      "mae_dtheta": 0.010419913567602634,
      "mae_dx": 0.0013503199443221092,
      "mae_dy": 0.0025236185174435377,
      "pose_mae_dtheta": 0.06749989837408066,
      "pose_mae_dx": 0.022463589906692505,
      "pose_mae_dy": 0.03193489462137222,
      "pose_rmse_dtheta": 0.1370457112789154,
      "pose_rmse_dx": 0.05903153121471405,
      "pose_rmse_dy": 0.06991564482450485,
      "pose_rmse_mean": 0.08866429328918457,
      "rmse_dtheta": 0.020347334444522858,
      "rmse_dx": 0.0038375507574528456,
      "rmse_dy": 0.005060013383626938,
      "rmse_mean": 0.009748299606144428,
      "rotation_flip": 0.004441154655069113,
      "sparse_tokens": 32073.0,
      "step": 10972,
      "turn_loss": 0.07940138131380081,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37638.0,
      "epoch": 0.5098030105928266,
      "grad_norm": 0.43916764855384827,
      "learning_rate": 1.8361868360718738e-07,
      "loss": 0.1133,
      "mae_dtheta": 0.03408132866024971,
      "mae_dx": 0.011132345534861088,
      "mae_dy": 0.003913382068276405,
      "pose_mae_dtheta": 0.2689734995365143,
      "pose_mae_dx": 0.08851395547389984,
      "pose_mae_dy": 0.05363745242357254,
      "pose_rmse_dtheta": 0.49691951274871826,
      "pose_rmse_dx": 0.21410323679447174,
      "pose_rmse_dy": 0.1422666311264038,
      "pose_rmse_mean": 0.28442978858947754,
      "rmse_dtheta": 0.05414460226893425,
      "rmse_dx": 0.02376016229391098,
      "rmse_dy": 0.008318341337144375,
      "rmse_mean": 0.028741035610437393,
      "rotation_flip": 0.012594458647072315,
      "sparse_tokens": 29697.0,
      "step": 10973,
      "turn_loss": 0.2717505693435669,
      "turns": 116.0,
      "turns_per_sample": 116.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.5098494703586693,
      "grad_norm": 0.4985179007053375,
      "learning_rate": 1.8326381995367294e-07,
      "loss": 0.0942,
      "mae_dtheta": 0.028639959171414375,
      "mae_dx": 0.01059627067297697,
      "mae_dy": 0.003188973292708397,
      "pose_mae_dtheta": 0.218916654586792,
      "pose_mae_dx": 0.08049900829792023,
      "pose_mae_dy": 0.03312823548913002,
      "pose_rmse_dtheta": 0.42683711647987366,
      "pose_rmse_dx": 0.1720951348543167,
      "pose_rmse_dy": 0.07579773664474487,
      "pose_rmse_mean": 0.22491000592708588,
      "rmse_dtheta": 0.0471913143992424,
      "rmse_dx": 0.020330868661403656,
      "rmse_dy": 0.006325017660856247,
      "rmse_mean": 0.024615734815597534,
      "rotation_flip": 0.008474576286971569,
      "sparse_tokens": 10831.0,
      "step": 10974,
      "turn_loss": 0.206101194024086,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5098959301245122,
      "grad_norm": 0.5846813321113586,
      "learning_rate": 1.8290929313710514e-07,
      "loss": 0.1986,
      "mae_dtheta": 0.009816986508667469,
      "mae_dx": 0.0017335036536678672,
      "mae_dy": 0.0024231262505054474,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5846813917160034,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.25503540039062,
      "model/head/act_norm_mean": 104.26992582070707,
      "model/head/act_norm_min": 66.40447235107422,
      "model/head/act_over_embed": 71.65526921441557,
      "model/head/grad_frac": 0.11195295304059982,
      "model/head/grad_norm": 0.0654568076133728,
      "model/head/grad_zero_frac": 0.0001338886795565486,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7092556423611112,
      "model/head/update_ratio": 0.001114267623052001,
      "model/head/weight_delta": 9.980974197387695,
      "model/head/weight_delta_rel": 0.17509585618972778,
      "model/head/weight_norm": 58.74424362182617,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42290231585502625,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42284560530153037,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227830767631531,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905834587061395,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06030156835913658,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03525720536708832,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5520922517123288,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011384343961253762,
      "model/modality_embedder.encoders.pose/weight_delta": 3.155595541000366,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1031031385064125,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969905853271484,
      "model/modality_embedder/grad_frac": 0.06030156835913658,
      "model/modality_embedder/grad_norm": 0.03525720536708832,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5520922517123288,
      "model/modality_embedder/update_ratio": 0.0011384343961253762,
      "model/modality_embedder/weight_delta": 3.155595541000366,
      "model/modality_embedder/weight_delta_rel": 0.1031031385064125,
      "model/modality_embedder/weight_norm": 30.969905853271484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.40013122558594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.0835588023088,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.999974250793457,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.86323772062901,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08116884529590607,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04745791479945183,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001697308151051402,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7401084899902344,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09985120594501495,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960695266723633,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.3046875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.036039963123297,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.387883186340332,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.517791691609855,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07826589792966843,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.045760612934827805,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0015371425542980433,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4740681648254395,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12034443765878677,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.769920349121094,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.08893585205078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.858763728555395,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.378363609313965,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.77038452782354,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07583305984735489,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.044338177889585495,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014422908425331116,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7636685371398926,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1263769418001175,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.741497039794922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.81039428710938,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.614513187429854,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.469321250915527,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.97695199354748,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0747399851679802,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.043699078261852264,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014588313642889261,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2349910736083984,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11055663973093033,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.954853057861328,
      "model/normalizer/grad_frac": 0.27267155051231384,
      "model/normalizer/grad_norm": 0.1594259887933731,
      "model/normalizer/grad_zero_frac": 0.0002115311799570918,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020268503576517105,
      "model/normalizer/weight_delta": 6.803610324859619,
      "model/normalizer/weight_delta_rel": 0.08762656152248383,
      "model/normalizer/weight_norm": 78.65701293945312,
      "pose_mae_dtheta": 0.059735432267189026,
      "pose_mae_dx": 0.021549498662352562,
      "pose_mae_dy": 0.025591488927602768,
      "pose_rmse_dtheta": 0.13167470693588257,
      "pose_rmse_dx": 0.05441529303789139,
      "pose_rmse_dy": 0.05335531383752823,
      "pose_rmse_mean": 0.0798151046037674,
      "rmse_dtheta": 0.020844176411628723,
      "rmse_dx": 0.006051845848560333,
      "rmse_dy": 0.005746573209762573,
      "rmse_mean": 0.010880865156650543,
      "rotation_flip": 0.003979307599365711,
      "sparse_tokens": 32073.0,
      "step": 10975,
      "turn_loss": 0.09350386261940002,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.509942389890355,
      "grad_norm": 0.4684487283229828,
      "learning_rate": 1.8255510318227642e-07,
      "loss": 0.1456,
      "mae_dtheta": 0.03435800224542618,
      "mae_dx": 0.01171865127980709,
      "mae_dy": 0.006081708706915379,
      "pose_mae_dtheta": 0.2630709707736969,
      "pose_mae_dx": 0.09633845835924149,
      "pose_mae_dy": 0.06868473440408707,
      "pose_rmse_dtheta": 0.47822362184524536,
      "pose_rmse_dx": 0.2019200176000595,
      "pose_rmse_dy": 0.1783757209777832,
      "pose_rmse_mean": 0.28617313504219055,
      "rmse_dtheta": 0.05310375243425369,
      "rmse_dx": 0.023293301463127136,
      "rmse_dy": 0.012380879372358322,
      "rmse_mean": 0.029592644423246384,
      "rotation_flip": 0.018390804529190063,
      "sparse_tokens": 20976.0,
      "step": 10976,
      "turn_loss": 0.30756285786628723,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5099888496561977,
      "grad_norm": 0.41859376430511475,
      "learning_rate": 1.8220125011395419e-07,
      "loss": 0.0822,
      "mae_dtheta": 0.00723688118159771,
      "mae_dx": 0.0024788840673863888,
      "mae_dy": 0.0006349185714498162,
      "pose_mae_dtheta": 0.04549384117126465,
      "pose_mae_dx": 0.022040650248527527,
      "pose_mae_dy": 0.008318771608173847,
      "pose_rmse_dtheta": 0.19837911427021027,
      "pose_rmse_dx": 0.054147910326719284,
      "pose_rmse_dy": 0.024732869118452072,
      "pose_rmse_mean": 0.09241996705532074,
      "rmse_dtheta": 0.026566332206130028,
      "rmse_dx": 0.007444263435900211,
      "rmse_dy": 0.0015278280479833484,
      "rmse_mean": 0.011846141889691353,
      "rotation_flip": 0.004219409078359604,
      "sparse_tokens": 32185.0,
      "step": 10977,
      "turn_loss": 0.08611270785331726,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.5100353094220406,
      "grad_norm": 0.5278894305229187,
      "learning_rate": 1.8184773395688527e-07,
      "loss": 0.1058,
      "mae_dtheta": 0.03685522824525833,
      "mae_dx": 0.012521132826805115,
      "mae_dy": 0.0055904448963701725,
      "pose_mae_dtheta": 0.2834312617778778,
      "pose_mae_dx": 0.09983596950769424,
      "pose_mae_dy": 0.08183379471302032,
      "pose_rmse_dtheta": 0.4983392655849457,
      "pose_rmse_dx": 0.20269769430160522,
      "pose_rmse_dy": 0.19395440816879272,
      "pose_rmse_mean": 0.2983304560184479,
      "rmse_dtheta": 0.05606343597173691,
      "rmse_dx": 0.024727992713451385,
      "rmse_dy": 0.011658198200166225,
      "rmse_mean": 0.030816543847322464,
      "rotation_flip": 0.016551723703742027,
      "sparse_tokens": 11174.0,
      "step": 10978,
      "turn_loss": 0.27772045135498047,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.5100817691878833,
      "grad_norm": 0.477845162153244,
      "learning_rate": 1.814945547357899e-07,
      "loss": 0.0991,
      "mae_dtheta": 0.027083460241556168,
      "mae_dx": 0.015195946209132671,
      "mae_dy": 0.005761077161878347,
      "pose_mae_dtheta": 0.18054315447807312,
      "pose_mae_dx": 0.11184337735176086,
      "pose_mae_dy": 0.06966215372085571,
      "pose_rmse_dtheta": 0.30562135577201843,
      "pose_rmse_dx": 0.2292962521314621,
      "pose_rmse_dy": 0.12454733997583389,
      "pose_rmse_mean": 0.21982166171073914,
      "rmse_dtheta": 0.04178885743021965,
      "rmse_dx": 0.02733663097023964,
      "rmse_dy": 0.009699943475425243,
      "rmse_mean": 0.026275143027305603,
      "rotation_flip": 0.011976048350334167,
      "sparse_tokens": 2838.0,
      "step": 10979,
      "turn_loss": 0.2975299656391144,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5101282289537261,
      "grad_norm": 0.3281193673610687,
      "learning_rate": 1.811417124753667e-07,
      "loss": 0.079,
      "mae_dtheta": 0.009144908748567104,
      "mae_dx": 0.0014576907269656658,
      "mae_dy": 0.0018813669448718429,
      "pose_mae_dtheta": 0.0638343021273613,
      "pose_mae_dx": 0.014966572634875774,
      "pose_mae_dy": 0.02059031091630459,
      "pose_rmse_dtheta": 0.1939074546098709,
      "pose_rmse_dx": 0.038720566779375076,
      "pose_rmse_dy": 0.0473179817199707,
      "pose_rmse_mean": 0.09331533312797546,
      "rmse_dtheta": 0.022296782582998276,
      "rmse_dx": 0.0049265711568295956,
      "rmse_dy": 0.005442157853394747,
      "rmse_mean": 0.010888504795730114,
      "rotation_flip": 0.0011990407947450876,
      "sparse_tokens": 32121.0,
      "step": 10980,
      "turn_loss": 0.0684577003121376,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.5101746887195688,
      "grad_norm": 1.2650266885757446,
      "learning_rate": 1.807892072002898e-07,
      "loss": 0.2539,
      "mae_dtheta": 0.028665853664278984,
      "mae_dx": 0.010648760013282299,
      "mae_dy": 0.005309692118316889,
      "pose_mae_dtheta": 0.21436700224876404,
      "pose_mae_dx": 0.09152428060770035,
      "pose_mae_dy": 0.053501080721616745,
      "pose_rmse_dtheta": 0.3724524676799774,
      "pose_rmse_dx": 0.21048937737941742,
      "pose_rmse_dy": 0.1300758421421051,
      "pose_rmse_mean": 0.2376725673675537,
      "rmse_dtheta": 0.04292457550764084,
      "rmse_dx": 0.02270100638270378,
      "rmse_dy": 0.010296436958014965,
      "rmse_mean": 0.025307338684797287,
      "rotation_flip": 0.027681661769747734,
      "sparse_tokens": 9460.0,
      "step": 10981,
      "turn_loss": 0.22965626418590546,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5102211484854117,
      "grad_norm": 0.33659422397613525,
      "learning_rate": 1.8043703893521003e-07,
      "loss": 0.081,
      "mae_dtheta": 0.012360618449747562,
      "mae_dx": 0.0018095334526151419,
      "mae_dy": 0.002974573988467455,
      "pose_mae_dtheta": 0.07735627144575119,
      "pose_mae_dx": 0.022748880088329315,
      "pose_mae_dy": 0.03548913449048996,
      "pose_rmse_dtheta": 0.18427948653697968,
      "pose_rmse_dx": 0.06191983446478844,
      "pose_rmse_dy": 0.10817163437604904,
      "pose_rmse_mean": 0.11812365055084229,
      "rmse_dtheta": 0.024701744318008423,
      "rmse_dx": 0.004907690919935703,
      "rmse_dy": 0.007089389022439718,
      "rmse_mean": 0.012232940644025803,
      "rotation_flip": 0.006704659666866064,
      "sparse_tokens": 32137.0,
      "step": 10982,
      "turn_loss": 0.09826095402240753,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.5102676082512544,
      "grad_norm": 0.6145983338356018,
      "learning_rate": 1.8008520770475547e-07,
      "loss": 0.191,
      "mae_dtheta": 0.0385642871260643,
      "mae_dx": 0.012498700991272926,
      "mae_dy": 0.008521459996700287,
      "pose_mae_dtheta": 0.3028218150138855,
      "pose_mae_dx": 0.09731967002153397,
      "pose_mae_dy": 0.0723508968949318,
      "pose_rmse_dtheta": 0.5852493047714233,
      "pose_rmse_dx": 0.2464059591293335,
      "pose_rmse_dy": 0.18802721798419952,
      "pose_rmse_mean": 0.33989417552948,
      "rmse_dtheta": 0.062004271894693375,
      "rmse_dx": 0.02668675221502781,
      "rmse_dy": 0.019746845588088036,
      "rmse_mean": 0.03614595904946327,
      "rotation_flip": 0.017543859779834747,
      "sparse_tokens": 10832.0,
      "step": 10983,
      "turn_loss": 0.3114481568336487,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5103140680170972,
      "grad_norm": 0.30401715636253357,
      "learning_rate": 1.797337135335292e-07,
      "loss": 0.0835,
      "mae_dtheta": 0.008371558040380478,
      "mae_dx": 0.0016515241004526615,
      "mae_dy": 0.00216539204120636,
      "pose_mae_dtheta": 0.05276020988821983,
      "pose_mae_dx": 0.018752027302980423,
      "pose_mae_dy": 0.02173863910138607,
      "pose_rmse_dtheta": 0.12397775799036026,
      "pose_rmse_dx": 0.0512448213994503,
      "pose_rmse_dy": 0.04976401850581169,
      "pose_rmse_mean": 0.07499553263187408,
      "rmse_dtheta": 0.017796477302908897,
      "rmse_dx": 0.005234679207205772,
      "rmse_dy": 0.0051106554456055164,
      "rmse_mean": 0.009380604140460491,
      "rotation_flip": 0.010195758193731308,
      "sparse_tokens": 32105.0,
      "step": 10984,
      "turn_loss": 0.07475004345178604,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5103605277829399,
      "grad_norm": 0.43831995129585266,
      "learning_rate": 1.7938255644611157e-07,
      "loss": 0.1282,
      "mae_dtheta": 0.008062341250479221,
      "mae_dx": 0.0016099016647785902,
      "mae_dy": 0.001557300565764308,
      "pose_mae_dtheta": 0.05509175360202789,
      "pose_mae_dx": 0.016471998766064644,
      "pose_mae_dy": 0.019597986713051796,
      "pose_rmse_dtheta": 0.13530391454696655,
      "pose_rmse_dx": 0.048916079103946686,
      "pose_rmse_dy": 0.05095722898840904,
      "pose_rmse_mean": 0.0783924087882042,
      "rmse_dtheta": 0.01872706227004528,
      "rmse_dx": 0.004411524161696434,
      "rmse_dy": 0.003883273573592305,
      "rmse_mean": 0.009007287211716175,
      "rotation_flip": 0.004521167371422052,
      "sparse_tokens": 32185.0,
      "step": 10985,
      "turn_loss": 0.06035633385181427,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5104069875487828,
      "grad_norm": 0.44368383288383484,
      "learning_rate": 1.7903173646705908e-07,
      "loss": 0.0862,
      "mae_dtheta": 0.013934426009654999,
      "mae_dx": 0.0036151453386992216,
      "mae_dy": 0.004866621922701597,
      "pose_mae_dtheta": 0.0917993038892746,
      "pose_mae_dx": 0.039239272475242615,
      "pose_mae_dy": 0.04951632767915726,
      "pose_rmse_dtheta": 0.2129417359828949,
      "pose_rmse_dx": 0.13515618443489075,
      "pose_rmse_dy": 0.15275812149047852,
      "pose_rmse_mean": 0.1669520139694214,
      "rmse_dtheta": 0.0271084513515234,
      "rmse_dx": 0.012899021618068218,
      "rmse_dy": 0.012617690488696098,
      "rmse_mean": 0.01754172146320343,
      "rotation_flip": 0.0057724956423044205,
      "sparse_tokens": 32089.0,
      "step": 10986,
      "turn_loss": 0.15052907168865204,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5104534473146255,
      "grad_norm": 0.4731602668762207,
      "learning_rate": 1.7868125362090482e-07,
      "loss": 0.1017,
      "mae_dtheta": 0.01015557162463665,
      "mae_dx": 0.0014443510444834828,
      "mae_dy": 0.002142560901120305,
      "pose_mae_dtheta": 0.06687692552804947,
      "pose_mae_dx": 0.017315618693828583,
      "pose_mae_dy": 0.019026299938559532,
      "pose_rmse_dtheta": 0.1886516809463501,
      "pose_rmse_dx": 0.048670463263988495,
      "pose_rmse_dy": 0.05278695374727249,
      "pose_rmse_mean": 0.09670303761959076,
      "rmse_dtheta": 0.02489728294312954,
      "rmse_dx": 0.004269957076758146,
      "rmse_dy": 0.005877923220396042,
      "rmse_mean": 0.011681720614433289,
      "rotation_flip": 0.003054101252928376,
      "sparse_tokens": 32137.0,
      "step": 10987,
      "turn_loss": 0.08308840543031693,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.5104999070804683,
      "grad_norm": 0.5366454720497131,
      "learning_rate": 1.7833110793215812e-07,
      "loss": 0.1186,
      "mae_dtheta": 0.028853436931967735,
      "mae_dx": 0.009398750960826874,
      "mae_dy": 0.003943571820855141,
      "pose_mae_dtheta": 0.22926437854766846,
      "pose_mae_dx": 0.07234311103820801,
      "pose_mae_dy": 0.04490324482321739,
      "pose_rmse_dtheta": 0.4300031065940857,
      "pose_rmse_dx": 0.18148508667945862,
      "pose_rmse_dy": 0.10981488227844238,
      "pose_rmse_mean": 0.24043437838554382,
      "rmse_dtheta": 0.04665975645184517,
      "rmse_dx": 0.021111054345965385,
      "rmse_dy": 0.007688109762966633,
      "rmse_mean": 0.02515297383069992,
      "rotation_flip": 0.013210039585828781,
      "sparse_tokens": 13729.0,
      "step": 10988,
      "turn_loss": 0.21528775990009308,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.510546366846311,
      "grad_norm": 0.5795475840568542,
      "learning_rate": 1.779812994253055e-07,
      "loss": 0.1428,
      "mae_dtheta": 0.005903150886297226,
      "mae_dx": 0.0009280770900659263,
      "mae_dy": 0.0012181141646578908,
      "pose_mae_dtheta": 0.04033597931265831,
      "pose_mae_dx": 0.010327985510230064,
      "pose_mae_dy": 0.014872106723487377,
      "pose_rmse_dtheta": 0.12234858423471451,
      "pose_rmse_dx": 0.025792082771658897,
      "pose_rmse_dy": 0.0350947342813015,
      "pose_rmse_mean": 0.06107847020030022,
      "rmse_dtheta": 0.014349706470966339,
      "rmse_dx": 0.002695187460631132,
      "rmse_dy": 0.0028203646652400494,
      "rmse_mean": 0.006621753331273794,
      "rotation_flip": 0.0020475019700825214,
      "sparse_tokens": 32121.0,
      "step": 10989,
      "turn_loss": 0.04417926073074341,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5105928266121539,
      "grad_norm": 0.44867604970932007,
      "learning_rate": 1.776318281248085e-07,
      "loss": 0.1262,
      "mae_dtheta": 0.009430548176169395,
      "mae_dx": 0.0021963033359497786,
      "mae_dy": 0.0033226655796170235,
      "pose_mae_dtheta": 0.07093445211648941,
      "pose_mae_dx": 0.019784191623330116,
      "pose_mae_dy": 0.023841993883252144,
      "pose_rmse_dtheta": 0.1723320037126541,
      "pose_rmse_dx": 0.05137603357434273,
      "pose_rmse_dy": 0.06276696920394897,
      "pose_rmse_mean": 0.0954916700720787,
      "rmse_dtheta": 0.02126753143966198,
      "rmse_dx": 0.0066298311576247215,
      "rmse_dy": 0.0095171257853508,
      "rmse_mean": 0.012471496127545834,
      "rotation_flip": 0.0067881387658417225,
      "sparse_tokens": 32153.0,
      "step": 10990,
      "turn_loss": 0.10212147980928421,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.5106392863779966,
      "grad_norm": 0.3806607127189636,
      "learning_rate": 1.772826940551059e-07,
      "loss": 0.0849,
      "mae_dtheta": 0.044095393270254135,
      "mae_dx": 0.005276067182421684,
      "mae_dy": 0.007895342074334621,
      "pose_mae_dtheta": 0.33343952894210815,
      "pose_mae_dx": 0.052507974207401276,
      "pose_mae_dy": 0.08162640780210495,
      "pose_rmse_dtheta": 0.5917322635650635,
      "pose_rmse_dx": 0.1088060811161995,
      "pose_rmse_dy": 0.19879423081874847,
      "pose_rmse_mean": 0.2997775375843048,
      "rmse_dtheta": 0.06749492883682251,
      "rmse_dx": 0.011634989641606808,
      "rmse_dy": 0.018140817061066628,
      "rmse_mean": 0.03242357820272446,
      "rotation_flip": 0.007751937955617905,
      "sparse_tokens": 4264.0,
      "step": 10991,
      "turn_loss": 0.3647407591342926,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.5106857461438394,
      "grad_norm": 0.6648962497711182,
      "learning_rate": 1.7693389724061317e-07,
      "loss": 0.1393,
      "mae_dtheta": 0.032648127526044846,
      "mae_dx": 0.011290576308965683,
      "mae_dy": 0.005931379739195108,
      "pose_mae_dtheta": 0.27141711115837097,
      "pose_mae_dx": 0.08870921283960342,
      "pose_mae_dy": 0.07553887367248535,
      "pose_rmse_dtheta": 0.47092708945274353,
      "pose_rmse_dx": 0.20425181090831757,
      "pose_rmse_dy": 0.1673354208469391,
      "pose_rmse_mean": 0.28083810210227966,
      "rmse_dtheta": 0.04949844256043434,
      "rmse_dx": 0.022769806906580925,
      "rmse_dy": 0.011400642804801464,
      "rmse_mean": 0.02788962982594967,
      "rotation_flip": 0.014204545877873898,
      "sparse_tokens": 13143.0,
      "step": 10992,
      "turn_loss": 0.28558599948883057,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 24014.0,
      "epoch": 0.5107322059096823,
      "grad_norm": 0.47422534227371216,
      "learning_rate": 1.765854377057219e-07,
      "loss": 0.1335,
      "mae_dtheta": 0.027163930237293243,
      "mae_dx": 0.006180044263601303,
      "mae_dy": 0.005337881855666637,
      "pose_mae_dtheta": 0.20723828673362732,
      "pose_mae_dx": 0.050385065376758575,
      "pose_mae_dy": 0.06533926725387573,
      "pose_rmse_dtheta": 0.398480623960495,
      "pose_rmse_dx": 0.12338016927242279,
      "pose_rmse_dy": 0.18118718266487122,
      "pose_rmse_mean": 0.2343493402004242,
      "rmse_dtheta": 0.04257569462060928,
      "rmse_dx": 0.0157706830650568,
      "rmse_dy": 0.01116337813436985,
      "rmse_mean": 0.02316991798579693,
      "rotation_flip": 0.012787723913788795,
      "sparse_tokens": 18474.0,
      "step": 10993,
      "turn_loss": 0.24486283957958221,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 10052.0,
      "epoch": 0.510778665675525,
      "grad_norm": 0.43689998984336853,
      "learning_rate": 1.7623731547479929e-07,
      "loss": 0.0997,
      "mae_dtheta": 0.02586996927857399,
      "mae_dx": 0.008240491151809692,
      "mae_dy": 0.006002392154186964,
      "pose_mae_dtheta": 0.20432300865650177,
      "pose_mae_dx": 0.06106186285614967,
      "pose_mae_dy": 0.07871927320957184,
      "pose_rmse_dtheta": 0.3869014084339142,
      "pose_rmse_dx": 0.1487397700548172,
      "pose_rmse_dy": 0.18182773888111115,
      "pose_rmse_mean": 0.2391563057899475,
      "rmse_dtheta": 0.04172169789671898,
      "rmse_dx": 0.019293949007987976,
      "rmse_dy": 0.011415211483836174,
      "rmse_mean": 0.02414361946284771,
      "rotation_flip": 0.008163264952600002,
      "sparse_tokens": 8087.0,
      "step": 10994,
      "turn_loss": 0.27469536662101746,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 17211.0,
      "epoch": 0.5108251254413678,
      "grad_norm": 0.8734413981437683,
      "learning_rate": 1.7588953057219083e-07,
      "loss": 0.1867,
      "mae_dtheta": 0.026455538347363472,
      "mae_dx": 0.008432446047663689,
      "mae_dy": 0.002879992825910449,
      "pose_mae_dtheta": 0.18187327682971954,
      "pose_mae_dx": 0.06139532849192619,
      "pose_mae_dy": 0.038996580988168716,
      "pose_rmse_dtheta": 0.34932953119277954,
      "pose_rmse_dx": 0.15054084360599518,
      "pose_rmse_dy": 0.1138717383146286,
      "pose_rmse_mean": 0.20458070933818817,
      "rmse_dtheta": 0.04482516646385193,
      "rmse_dx": 0.019248751923441887,
      "rmse_dy": 0.00621007801964879,
      "rmse_mean": 0.023428000509738922,
      "rotation_flip": 0.019430052489042282,
      "sparse_tokens": 14583.0,
      "step": 10995,
      "turn_loss": 0.15048496425151825,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.5108715852072105,
      "grad_norm": 0.7324548959732056,
      "learning_rate": 1.7554208302221654e-07,
      "loss": 0.157,
      "mae_dtheta": 0.041063420474529266,
      "mae_dx": 0.013074804097414017,
      "mae_dy": 0.008212811313569546,
      "pose_mae_dtheta": 0.32843080163002014,
      "pose_mae_dx": 0.10391376167535782,
      "pose_mae_dy": 0.08643948286771774,
      "pose_rmse_dtheta": 0.5315437316894531,
      "pose_rmse_dx": 0.216698557138443,
      "pose_rmse_dy": 0.20354917645454407,
      "pose_rmse_mean": 0.31726381182670593,
      "rmse_dtheta": 0.059027064591646194,
      "rmse_dx": 0.024579716846346855,
      "rmse_dy": 0.01692783460021019,
      "rmse_mean": 0.03351154178380966,
      "rotation_flip": 0.018322082236409187,
      "sparse_tokens": 17514.0,
      "step": 10996,
      "turn_loss": 0.2945851981639862,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5109180449730534,
      "grad_norm": 0.4794769585132599,
      "learning_rate": 1.751949728491742e-07,
      "loss": 0.1524,
      "mae_dtheta": 0.00608408497646451,
      "mae_dx": 0.0011523485882207751,
      "mae_dy": 0.0018201004713773727,
      "pose_mae_dtheta": 0.039439767599105835,
      "pose_mae_dx": 0.01862877793610096,
      "pose_mae_dy": 0.018859557807445526,
      "pose_rmse_dtheta": 0.09707731008529663,
      "pose_rmse_dx": 0.04796195775270462,
      "pose_rmse_dy": 0.04212082549929619,
      "pose_rmse_mean": 0.06238669902086258,
      "rmse_dtheta": 0.015450173988938332,
      "rmse_dx": 0.00298587535507977,
      "rmse_dy": 0.0040311068296432495,
      "rmse_mean": 0.007489052601158619,
      "rotation_flip": 0.003977724816650152,
      "sparse_tokens": 32105.0,
      "step": 10997,
      "turn_loss": 0.049729686230421066,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5109645047388961,
      "grad_norm": 0.36510518193244934,
      "learning_rate": 1.7484820007733606e-07,
      "loss": 0.094,
      "mae_dtheta": 0.010461142286658287,
      "mae_dx": 0.0012422779109328985,
      "mae_dy": 0.0023290852550417185,
      "pose_mae_dtheta": 0.06428030133247375,
      "pose_mae_dx": 0.01871335133910179,
      "pose_mae_dy": 0.024592315778136253,
      "pose_rmse_dtheta": 0.16060765087604523,
      "pose_rmse_dx": 0.050091974437236786,
      "pose_rmse_dy": 0.05132263898849487,
      "pose_rmse_mean": 0.08734075725078583,
      "rmse_dtheta": 0.02234840951859951,
      "rmse_dx": 0.0037495270371437073,
      "rmse_dy": 0.004718033131211996,
      "rmse_mean": 0.010271990671753883,
      "rotation_flip": 0.005809450056403875,
      "sparse_tokens": 32089.0,
      "step": 10998,
      "turn_loss": 0.07662010937929153,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.5110109645047389,
      "grad_norm": 0.6224784255027771,
      "learning_rate": 1.7450176473095436e-07,
      "loss": 0.1204,
      "mae_dtheta": 0.04008793458342552,
      "mae_dx": 0.01457154843956232,
      "mae_dy": 0.008603382855653763,
      "pose_mae_dtheta": 0.3407873511314392,
      "pose_mae_dx": 0.12377555668354034,
      "pose_mae_dy": 0.09863939136266708,
      "pose_rmse_dtheta": 0.5641997456550598,
      "pose_rmse_dx": 0.25336045026779175,
      "pose_rmse_dy": 0.21133139729499817,
      "pose_rmse_mean": 0.3429638743400574,
      "rmse_dtheta": 0.05829507112503052,
      "rmse_dx": 0.026871493086218834,
      "rmse_dy": 0.01668648049235344,
      "rmse_mean": 0.033951014280319214,
      "rotation_flip": 0.014652014710009098,
      "sparse_tokens": 14209.0,
      "step": 10999,
      "turn_loss": 0.32408586144447327,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5110574242705817,
      "grad_norm": 0.4640280604362488,
      "learning_rate": 1.7415566683425312e-07,
      "loss": 0.1112,
      "mae_dtheta": 0.010036053135991096,
      "mae_dx": 0.0021827637683600187,
      "mae_dy": 0.003890562802553177,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.464028000831604,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 144.81642150878906,
      "model/head/act_norm_mean": 99.65981100063131,
      "model/head/act_norm_min": 48.78208923339844,
      "model/head/act_over_embed": 68.48715514948455,
      "model/head/grad_frac": 0.12109632045030594,
      "model/head/grad_norm": 0.05619208514690399,
      "model/head/grad_zero_frac": 0.00018274853937327862,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7089054608585859,
      "model/head/update_ratio": 0.0009565541404299438,
      "model/head/weight_delta": 9.981374740600586,
      "model/head/weight_delta_rel": 0.17510287463665009,
      "model/head/weight_norm": 58.74428176879883,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229232668876648,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.422851217278528,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42279013991355896,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29058731530927245,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09772845357656479,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04534873738884926,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5481918127828054,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014642844907939434,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1557457447052,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10310804843902588,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96989631652832,
      "model/modality_embedder/grad_frac": 0.09772845357656479,
      "model/modality_embedder/grad_norm": 0.04534873738884926,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5481918127828054,
      "model/modality_embedder/update_ratio": 0.0014642844907939434,
      "model/modality_embedder/weight_delta": 3.1557457447052,
      "model/modality_embedder/weight_delta_rel": 0.10310804843902588,
      "model/modality_embedder/weight_norm": 30.96989631652832,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.35253143310547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.696628988295654,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.144725799560547,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.597335929945183,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07540439069271088,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.034989748150110245,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012513876426964998,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.740304470062256,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0998583510518074,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960758209228516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 86.04676055908203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.655212842712842,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.259232521057129,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.256083729104116,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08207099884748459,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.038083240389823914,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012792495544999838,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.474355697631836,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12035439908504486,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.76998519897461,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 88.00037384033203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.479720318261986,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.530303955078125,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.509902347609593,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08481321483850479,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03935570642352104,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012802118435502052,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.763967752456665,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12638698518276215,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.741558074951172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 88.77244567871094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.30229627625461,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.308693885803223,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.762393609167077,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09154237806797028,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.042478226125240326,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014180716825649142,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2352511882781982,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11056553572416306,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95492172241211,
      "model/normalizer/grad_frac": 0.3385053277015686,
      "model/normalizer/grad_norm": 0.15707595646381378,
      "model/normalizer/grad_zero_frac": 0.0001985320559469983,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0019969712011516094,
      "model/normalizer/weight_delta": 6.804144382476807,
      "model/normalizer/weight_delta_rel": 0.08763343840837479,
      "model/normalizer/weight_norm": 78.65709686279297,
      "pose_mae_dtheta": 0.06347974389791489,
      "pose_mae_dx": 0.02999822050333023,
      "pose_mae_dy": 0.036026500165462494,
      "pose_rmse_dtheta": 0.12761105597019196,
      "pose_rmse_dx": 0.07280327379703522,
      "pose_rmse_dy": 0.08318737894296646,
      "pose_rmse_mean": 0.09453390538692474,
      "rmse_dtheta": 0.01998046226799488,
      "rmse_dx": 0.005344004835933447,
      "rmse_dy": 0.008033216930925846,
      "rmse_mean": 0.011119227856397629,
      "rotation_flip": 0.00382608687505126,
      "sparse_tokens": 32089.0,
      "step": 11000,
      "turn_loss": 0.09399521350860596,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.5110574242705817,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.2998276650905609,
      "eval_objectnav_nopose_mae_dtheta": 0.03933437913656235,
      "eval_objectnav_nopose_mae_dx": 0.01301792822778225,
      "eval_objectnav_nopose_mae_dy": 0.004881467670202255,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3171643316745758,
      "eval_objectnav_nopose_pose_mae_dx": 0.10432431101799011,
      "eval_objectnav_nopose_pose_mae_dy": 0.054623547941446304,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5374440550804138,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23074160516262054,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12626001238822937,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29814857244491577,
      "eval_objectnav_nopose_rmse_dtheta": 0.05722179263830185,
      "eval_objectnav_nopose_rmse_dx": 0.02572222799062729,
      "eval_objectnav_nopose_rmse_dy": 0.0098375603556633,
      "eval_objectnav_nopose_rmse_mean": 0.03092719428241253,
      "eval_objectnav_nopose_rotation_flip": 0.015530087053775787,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.2998276650905609,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 11000
    },
    {
      "epoch": 0.5110574242705817,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2708640396595001,
      "eval_objectnav_pose_mae_dtheta": 0.03484960272908211,
      "eval_objectnav_pose_mae_dx": 0.010804791934788227,
      "eval_objectnav_pose_mae_dy": 0.004601824097335339,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26120662689208984,
      "eval_objectnav_pose_pose_mae_dx": 0.08430100232362747,
      "eval_objectnav_pose_pose_mae_dy": 0.048783715814352036,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46213290095329285,
      "eval_objectnav_pose_pose_rmse_dx": 0.19881345331668854,
      "eval_objectnav_pose_pose_rmse_dy": 0.1205001026391983,
      "eval_objectnav_pose_pose_rmse_mean": 0.26048216223716736,
      "eval_objectnav_pose_rmse_dtheta": 0.052689991891384125,
      "eval_objectnav_pose_rmse_dx": 0.022739263251423836,
      "eval_objectnav_pose_rmse_dy": 0.009635206311941147,
      "eval_objectnav_pose_rmse_mean": 0.028354819864034653,
      "eval_objectnav_pose_rotation_flip": 0.015018675476312637,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2708640396595001,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 11000
    },
    {
      "epoch": 0.5110574242705817,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08659712970256805,
      "eval_pointnav_mae_dtheta": 0.009839700534939766,
      "eval_pointnav_mae_dx": 0.002149235922843218,
      "eval_pointnav_mae_dy": 0.0023075025528669357,
      "eval_pointnav_pose_mae_dtheta": 0.06722103804349899,
      "eval_pointnav_pose_mae_dx": 0.023829329758882523,
      "eval_pointnav_pose_mae_dy": 0.02428799495100975,
      "eval_pointnav_pose_rmse_dtheta": 0.19859075546264648,
      "eval_pointnav_pose_rmse_dx": 0.07423298060894012,
      "eval_pointnav_pose_rmse_dy": 0.07113183289766312,
      "eval_pointnav_pose_rmse_mean": 0.11465185880661011,
      "eval_pointnav_rmse_dtheta": 0.02472437173128128,
      "eval_pointnav_rmse_dx": 0.006950559094548225,
      "eval_pointnav_rmse_dy": 0.006178039591759443,
      "eval_pointnav_rmse_mean": 0.012617656961083412,
      "eval_pointnav_rotation_flip": 0.005157245323061943,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08659712970256805,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 11000
    },
    {
      "epoch": 0.5110574242705817,
      "eval_loss": 0.21909627815087637,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.2998276650905609,
      "eval_objectnav_nopose_mae_dtheta": 0.03933437913656235,
      "eval_objectnav_nopose_mae_dx": 0.01301792822778225,
      "eval_objectnav_nopose_mae_dy": 0.004881467670202255,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3171643316745758,
      "eval_objectnav_nopose_pose_mae_dx": 0.10432431101799011,
      "eval_objectnav_nopose_pose_mae_dy": 0.054623547941446304,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5374440550804138,
      "eval_objectnav_nopose_pose_rmse_dx": 0.23074160516262054,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12626001238822937,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29814857244491577,
      "eval_objectnav_nopose_rmse_dtheta": 0.05722179263830185,
      "eval_objectnav_nopose_rmse_dx": 0.02572222799062729,
      "eval_objectnav_nopose_rmse_dy": 0.0098375603556633,
      "eval_objectnav_nopose_rmse_mean": 0.03092719428241253,
      "eval_objectnav_nopose_rotation_flip": 0.015530087053775787,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.2998276650905609,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2708640396595001,
      "eval_objectnav_pose_mae_dtheta": 0.03484960272908211,
      "eval_objectnav_pose_mae_dx": 0.010804791934788227,
      "eval_objectnav_pose_mae_dy": 0.004601824097335339,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26120662689208984,
      "eval_objectnav_pose_pose_mae_dx": 0.08430100232362747,
      "eval_objectnav_pose_pose_mae_dy": 0.048783715814352036,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.46213290095329285,
      "eval_objectnav_pose_pose_rmse_dx": 0.19881345331668854,
      "eval_objectnav_pose_pose_rmse_dy": 0.1205001026391983,
      "eval_objectnav_pose_pose_rmse_mean": 0.26048216223716736,
      "eval_objectnav_pose_rmse_dtheta": 0.052689991891384125,
      "eval_objectnav_pose_rmse_dx": 0.022739263251423836,
      "eval_objectnav_pose_rmse_dy": 0.009635206311941147,
      "eval_objectnav_pose_rmse_mean": 0.028354819864034653,
      "eval_objectnav_pose_rotation_flip": 0.015018675476312637,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2708640396595001,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08659712970256805,
      "eval_pointnav_mae_dtheta": 0.009839700534939766,
      "eval_pointnav_mae_dx": 0.002149235922843218,
      "eval_pointnav_mae_dy": 0.0023075025528669357,
      "eval_pointnav_pose_mae_dtheta": 0.06722103804349899,
      "eval_pointnav_pose_mae_dx": 0.023829329758882523,
      "eval_pointnav_pose_mae_dy": 0.02428799495100975,
      "eval_pointnav_pose_rmse_dtheta": 0.19859075546264648,
      "eval_pointnav_pose_rmse_dx": 0.07423298060894012,
      "eval_pointnav_pose_rmse_dy": 0.07113183289766312,
      "eval_pointnav_pose_rmse_mean": 0.11465185880661011,
      "eval_pointnav_rmse_dtheta": 0.02472437173128128,
      "eval_pointnav_rmse_dx": 0.006950559094548225,
      "eval_pointnav_rmse_dy": 0.006178039591759443,
      "eval_pointnav_rmse_mean": 0.012617656961083412,
      "eval_pointnav_rotation_flip": 0.005157245323061943,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08659712970256805,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 11000
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.5111038840364245,
      "grad_norm": 0.623934805393219,
      "learning_rate": 1.738099064114368e-07,
      "loss": 0.1495,
      "mae_dtheta": 0.021054618060588837,
      "mae_dx": 0.008345316164195538,
      "mae_dy": 0.003223871346563101,
      "pose_mae_dtheta": 0.15847660601139069,
      "pose_mae_dx": 0.08120653033256531,
      "pose_mae_dy": 0.0437142439186573,
      "pose_rmse_dtheta": 0.359904408454895,
      "pose_rmse_dx": 0.19845320284366608,
      "pose_rmse_dy": 0.12074751406908035,
      "pose_rmse_mean": 0.22636836767196655,
      "rmse_dtheta": 0.0404934398829937,
      "rmse_dx": 0.0201276782900095,
      "rmse_dy": 0.006998770870268345,
      "rmse_mean": 0.022539963945746422,
      "rotation_flip": 0.004291845485568047,
      "sparse_tokens": 11358.0,
      "step": 11001,
      "turn_loss": 0.14465218782424927,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 15591.0,
      "epoch": 0.5111503438022672,
      "grad_norm": 1.1145439147949219,
      "learning_rate": 1.7346448348668443e-07,
      "loss": 0.2229,
      "mae_dtheta": 0.02763621136546135,
      "mae_dx": 0.010859999805688858,
      "mae_dy": 0.006419918965548277,
      "pose_mae_dtheta": 0.19033049046993256,
      "pose_mae_dx": 0.09070591628551483,
      "pose_mae_dy": 0.06568241119384766,
      "pose_rmse_dtheta": 0.3213295638561249,
      "pose_rmse_dx": 0.20178723335266113,
      "pose_rmse_dy": 0.12872359156608582,
      "pose_rmse_mean": 0.21728014945983887,
      "rmse_dtheta": 0.04258301854133606,
      "rmse_dx": 0.022328486666083336,
      "rmse_dy": 0.014269948936998844,
      "rmse_mean": 0.026393819600343704,
      "rotation_flip": 0.006830601021647453,
      "sparse_tokens": 12571.0,
      "step": 11002,
      "turn_loss": 0.26795923709869385,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 37522.0,
      "epoch": 0.51119680356811,
      "grad_norm": 0.49120551347732544,
      "learning_rate": 1.7311939808415057e-07,
      "loss": 0.1124,
      "mae_dtheta": 0.03258591145277023,
      "mae_dx": 0.009801799431443214,
      "mae_dy": 0.00450146896764636,
      "pose_mae_dtheta": 0.253583163022995,
      "pose_mae_dx": 0.07799147069454193,
      "pose_mae_dy": 0.043442852795124054,
      "pose_rmse_dtheta": 0.4766790568828583,
      "pose_rmse_dx": 0.1954965591430664,
      "pose_rmse_dy": 0.09929142147302628,
      "pose_rmse_mean": 0.25715571641921997,
      "rmse_dtheta": 0.05248583108186722,
      "rmse_dx": 0.02158234268426895,
      "rmse_dy": 0.010695935226976871,
      "rmse_mean": 0.02825470268726349,
      "rotation_flip": 0.01149425283074379,
      "sparse_tokens": 29502.0,
      "step": 11003,
      "turn_loss": 0.26424339413642883,
      "turns": 116.0,
      "turns_per_sample": 116.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.5112432633339528,
      "grad_norm": 0.6582452058792114,
      "learning_rate": 1.7277465022796869e-07,
      "loss": 0.1625,
      "mae_dtheta": 0.031230945140123367,
      "mae_dx": 0.010641220025718212,
      "mae_dy": 0.0030254358425736427,
      "pose_mae_dtheta": 0.2436693161725998,
      "pose_mae_dx": 0.09538182616233826,
      "pose_mae_dy": 0.042475152760744095,
      "pose_rmse_dtheta": 0.4229477345943451,
      "pose_rmse_dx": 0.20159298181533813,
      "pose_rmse_dy": 0.09839163720607758,
      "pose_rmse_mean": 0.2409774512052536,
      "rmse_dtheta": 0.04804706200957298,
      "rmse_dx": 0.02204686589539051,
      "rmse_dy": 0.005897535476833582,
      "rmse_mean": 0.02533048950135708,
      "rotation_flip": 0.012027491815388203,
      "sparse_tokens": 9407.0,
      "step": 11004,
      "turn_loss": 0.22113947570323944,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.5112897230997956,
      "grad_norm": 0.5938715934753418,
      "learning_rate": 1.724302399422456e-07,
      "loss": 0.1538,
      "mae_dtheta": 0.047809988260269165,
      "mae_dx": 0.01594395563006401,
      "mae_dy": 0.010690136812627316,
      "pose_mae_dtheta": 0.37501445412635803,
      "pose_mae_dx": 0.1360466480255127,
      "pose_mae_dy": 0.0820484608411789,
      "pose_rmse_dtheta": 0.6084690690040588,
      "pose_rmse_dx": 0.28329259157180786,
      "pose_rmse_dy": 0.176632359623909,
      "pose_rmse_mean": 0.356131374835968,
      "rmse_dtheta": 0.06842119246721268,
      "rmse_dx": 0.02979736402630806,
      "rmse_dy": 0.02089998871088028,
      "rmse_mean": 0.03970618546009064,
      "rotation_flip": 0.020109688863158226,
      "sparse_tokens": 9387.0,
      "step": 11005,
      "turn_loss": 0.41857799887657166,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5113361828656383,
      "grad_norm": 0.3675437569618225,
      "learning_rate": 1.7208616725106818e-07,
      "loss": 0.0848,
      "mae_dtheta": 0.007734096609055996,
      "mae_dx": 0.0016491985879838467,
      "mae_dy": 0.0018412036588415504,
      "pose_mae_dtheta": 0.05163167044520378,
      "pose_mae_dx": 0.020691918209195137,
      "pose_mae_dy": 0.023136237636208534,
      "pose_rmse_dtheta": 0.12112686783075333,
      "pose_rmse_dx": 0.06319114565849304,
      "pose_rmse_dy": 0.06054597720503807,
      "pose_rmse_mean": 0.08162133395671844,
      "rmse_dtheta": 0.017228731885552406,
      "rmse_dx": 0.005164256785064936,
      "rmse_dy": 0.004720922093838453,
      "rmse_mean": 0.009037970565259457,
      "rotation_flip": 0.005842259153723717,
      "sparse_tokens": 32057.0,
      "step": 11006,
      "turn_loss": 0.07669409364461899,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5113826426314811,
      "grad_norm": 0.4514140784740448,
      "learning_rate": 1.7174243217849494e-07,
      "loss": 0.0917,
      "mae_dtheta": 0.009675874374806881,
      "mae_dx": 0.0011484870919957757,
      "mae_dy": 0.0020683081820607185,
      "pose_mae_dtheta": 0.06377511471509933,
      "pose_mae_dx": 0.016662724316120148,
      "pose_mae_dy": 0.03033132664859295,
      "pose_rmse_dtheta": 0.16422688961029053,
      "pose_rmse_dx": 0.041836824268102646,
      "pose_rmse_dy": 0.07453764975070953,
      "pose_rmse_mean": 0.09353379905223846,
      "rmse_dtheta": 0.021532772108912468,
      "rmse_dx": 0.00350880715996027,
      "rmse_dy": 0.004683817736804485,
      "rmse_mean": 0.009908466599881649,
      "rotation_flip": 0.007281553465873003,
      "sparse_tokens": 32089.0,
      "step": 11007,
      "turn_loss": 0.07659135013818741,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15590.0,
      "epoch": 0.5114291023973239,
      "grad_norm": 0.8678823709487915,
      "learning_rate": 1.7139903474856556e-07,
      "loss": 0.1481,
      "mae_dtheta": 0.034187138080596924,
      "mae_dx": 0.012742920778691769,
      "mae_dy": 0.00819800142198801,
      "pose_mae_dtheta": 0.26525622606277466,
      "pose_mae_dx": 0.10842084139585495,
      "pose_mae_dy": 0.08175651729106903,
      "pose_rmse_dtheta": 0.4144335985183716,
      "pose_rmse_dx": 0.21808744966983795,
      "pose_rmse_dy": 0.16232596337795258,
      "pose_rmse_mean": 0.2649490237236023,
      "rmse_dtheta": 0.04866304248571396,
      "rmse_dx": 0.024477265775203705,
      "rmse_dy": 0.01438046433031559,
      "rmse_mean": 0.0291735902428627,
      "rotation_flip": 0.012716762721538544,
      "sparse_tokens": 12935.0,
      "step": 11008,
      "turn_loss": 0.30282697081565857,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5114755621631667,
      "grad_norm": 0.4885426163673401,
      "learning_rate": 1.7105597498529358e-07,
      "loss": 0.1162,
      "mae_dtheta": 0.0068289972841739655,
      "mae_dx": 0.0012980949832126498,
      "mae_dy": 0.0015840204432606697,
      "pose_mae_dtheta": 0.04613146185874939,
      "pose_mae_dx": 0.017054913565516472,
      "pose_mae_dy": 0.019217759370803833,
      "pose_rmse_dtheta": 0.10955614596605301,
      "pose_rmse_dx": 0.046125926077365875,
      "pose_rmse_dy": 0.048215821385383606,
      "pose_rmse_mean": 0.06796596944332123,
      "rmse_dtheta": 0.016099076718091965,
      "rmse_dx": 0.00419766828417778,
      "rmse_dy": 0.0037394363898783922,
      "rmse_mean": 0.008012061007320881,
      "rotation_flip": 0.002434274647384882,
      "sparse_tokens": 32089.0,
      "step": 11009,
      "turn_loss": 0.05861596763134003,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5115220219290095,
      "grad_norm": 0.3899382948875427,
      "learning_rate": 1.7071325291266873e-07,
      "loss": 0.094,
      "mae_dtheta": 0.00913016777485609,
      "mae_dx": 0.0012164097279310226,
      "mae_dy": 0.0018475910183042288,
      "pose_mae_dtheta": 0.0622929185628891,
      "pose_mae_dx": 0.017653539776802063,
      "pose_mae_dy": 0.023140523582696915,
      "pose_rmse_dtheta": 0.15450426936149597,
      "pose_rmse_dx": 0.046396754682064056,
      "pose_rmse_dy": 0.052021149545907974,
      "pose_rmse_mean": 0.08430739492177963,
      "rmse_dtheta": 0.020766714587807655,
      "rmse_dx": 0.003971294034272432,
      "rmse_dy": 0.003914378117769957,
      "rmse_mean": 0.009550795890390873,
      "rotation_flip": 0.003216726938262582,
      "sparse_tokens": 32073.0,
      "step": 11010,
      "turn_loss": 0.06741590797901154,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.5115684816948523,
      "grad_norm": 0.6328258514404297,
      "learning_rate": 1.7037086855465902e-07,
      "loss": 0.1448,
      "mae_dtheta": 0.02509731613099575,
      "mae_dx": 0.006938209291547537,
      "mae_dy": 0.004229402635246515,
      "pose_mae_dtheta": 0.18125011026859283,
      "pose_mae_dx": 0.044277124106884,
      "pose_mae_dy": 0.05060620605945587,
      "pose_rmse_dtheta": 0.36575648188591003,
      "pose_rmse_dx": 0.10907042771577835,
      "pose_rmse_dy": 0.12901462614536285,
      "pose_rmse_mean": 0.20128051936626434,
      "rmse_dtheta": 0.04253459349274635,
      "rmse_dx": 0.01698499731719494,
      "rmse_dy": 0.010019655339419842,
      "rmse_mean": 0.02317974716424942,
      "rotation_flip": 0.014705882407724857,
      "sparse_tokens": 12436.0,
      "step": 11011,
      "turn_loss": 0.21926255524158478,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5116149414606951,
      "grad_norm": 0.5455049872398376,
      "learning_rate": 1.7002882193520588e-07,
      "loss": 0.1487,
      "mae_dtheta": 0.009068050421774387,
      "mae_dx": 0.0011747936950996518,
      "mae_dy": 0.0019388999789953232,
      "pose_mae_dtheta": 0.05697445571422577,
      "pose_mae_dx": 0.01808231696486473,
      "pose_mae_dy": 0.026610374450683594,
      "pose_rmse_dtheta": 0.13938497006893158,
      "pose_rmse_dx": 0.044368427246809006,
      "pose_rmse_dy": 0.05795736983418465,
      "pose_rmse_mean": 0.08057025820016861,
      "rmse_dtheta": 0.019917568191885948,
      "rmse_dx": 0.003586699953302741,
      "rmse_dy": 0.004049169365316629,
      "rmse_mean": 0.009184479713439941,
      "rotation_flip": 0.002223869552835822,
      "sparse_tokens": 32089.0,
      "step": 11012,
      "turn_loss": 0.0675053521990776,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17481.0,
      "epoch": 0.5116614012265378,
      "grad_norm": 0.7491509318351746,
      "learning_rate": 1.6968711307823015e-07,
      "loss": 0.1499,
      "mae_dtheta": 0.0306500606238842,
      "mae_dx": 0.008764080703258514,
      "mae_dy": 0.00432528555393219,
      "pose_mae_dtheta": 0.2456396222114563,
      "pose_mae_dx": 0.06780247390270233,
      "pose_mae_dy": 0.05092824995517731,
      "pose_rmse_dtheta": 0.5069635510444641,
      "pose_rmse_dx": 0.1577010303735733,
      "pose_rmse_dy": 0.12553831934928894,
      "pose_rmse_mean": 0.26340097188949585,
      "rmse_dtheta": 0.051648855209350586,
      "rmse_dx": 0.01968555338680744,
      "rmse_dy": 0.009114125743508339,
      "rmse_mean": 0.026816178113222122,
      "rotation_flip": 0.01097560953348875,
      "sparse_tokens": 14165.0,
      "step": 11013,
      "turn_loss": 0.21985961496829987,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5117078609923806,
      "grad_norm": 0.33628565073013306,
      "learning_rate": 1.6934574200762666e-07,
      "loss": 0.0757,
      "mae_dtheta": 0.004786019679158926,
      "mae_dx": 0.0014227476203814149,
      "mae_dy": 0.0007101768860593438,
      "pose_mae_dtheta": 0.0350889228284359,
      "pose_mae_dx": 0.014000249095261097,
      "pose_mae_dy": 0.009201319888234138,
      "pose_rmse_dtheta": 0.142445906996727,
      "pose_rmse_dx": 0.04368183761835098,
      "pose_rmse_dy": 0.023634307086467743,
      "pose_rmse_mean": 0.06992068886756897,
      "rmse_dtheta": 0.017359420657157898,
      "rmse_dx": 0.0046027968637645245,
      "rmse_dy": 0.002082041697576642,
      "rmse_mean": 0.008014753460884094,
      "rotation_flip": 0.003599711926653981,
      "sparse_tokens": 32121.0,
      "step": 11014,
      "turn_loss": 0.04139973595738411,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5117543207582234,
      "grad_norm": 0.6523488759994507,
      "learning_rate": 1.6900470874726792e-07,
      "loss": 0.1593,
      "mae_dtheta": 0.008578977547585964,
      "mae_dx": 0.001365919946692884,
      "mae_dy": 0.002129048341885209,
      "pose_mae_dtheta": 0.05532091483473778,
      "pose_mae_dx": 0.01837836764752865,
      "pose_mae_dy": 0.0190790593624115,
      "pose_rmse_dtheta": 0.1815434843301773,
      "pose_rmse_dx": 0.04925583675503731,
      "pose_rmse_dy": 0.04121513292193413,
      "pose_rmse_mean": 0.09067147970199585,
      "rmse_dtheta": 0.021059945225715637,
      "rmse_dx": 0.0038430169224739075,
      "rmse_dy": 0.004760407842695713,
      "rmse_mean": 0.00988779030740261,
      "rotation_flip": 0.0027910685166716576,
      "sparse_tokens": 32073.0,
      "step": 11015,
      "turn_loss": 0.06681252270936966,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5118007805240662,
      "grad_norm": 0.6060807108879089,
      "learning_rate": 1.6866401332100378e-07,
      "loss": 0.147,
      "mae_dtheta": 0.012573541142046452,
      "mae_dx": 0.0033880535047501326,
      "mae_dy": 0.0038372445851564407,
      "pose_mae_dtheta": 0.08821286261081696,
      "pose_mae_dx": 0.03635893017053604,
      "pose_mae_dy": 0.033816270530223846,
      "pose_rmse_dtheta": 0.22266894578933716,
      "pose_rmse_dx": 0.10968223959207535,
      "pose_rmse_dy": 0.07590082287788391,
      "pose_rmse_mean": 0.13608400523662567,
      "rmse_dtheta": 0.027881627902388573,
      "rmse_dx": 0.010303137823939323,
      "rmse_dy": 0.009311565198004246,
      "rmse_mean": 0.01583211123943329,
      "rotation_flip": 0.007198953069746494,
      "sparse_tokens": 32169.0,
      "step": 11016,
      "turn_loss": 0.13168512284755707,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.5118472402899089,
      "grad_norm": 0.40516936779022217,
      "learning_rate": 1.6832365575265742e-07,
      "loss": 0.1196,
      "mae_dtheta": 0.02575390413403511,
      "mae_dx": 0.010986884124577045,
      "mae_dy": 0.0033177873119711876,
      "pose_mae_dtheta": 0.16103434562683105,
      "pose_mae_dx": 0.0918368324637413,
      "pose_mae_dy": 0.02166544832289219,
      "pose_rmse_dtheta": 0.27166256308555603,
      "pose_rmse_dx": 0.2392050325870514,
      "pose_rmse_dy": 0.0403398759663105,
      "pose_rmse_mean": 0.18373583257198334,
      "rmse_dtheta": 0.03977687656879425,
      "rmse_dx": 0.023735936731100082,
      "rmse_dy": 0.006019224878400564,
      "rmse_mean": 0.02317734807729721,
      "rotation_flip": 0.009803921915590763,
      "sparse_tokens": 4768.0,
      "step": 11017,
      "turn_loss": 0.1791968047618866,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5118937000557517,
      "grad_norm": 0.2877366244792938,
      "learning_rate": 1.6798363606603197e-07,
      "loss": 0.075,
      "mae_dtheta": 0.007197171449661255,
      "mae_dx": 0.0010226750746369362,
      "mae_dy": 0.0015000327257439494,
      "pose_mae_dtheta": 0.04383186995983124,
      "pose_mae_dx": 0.011960236355662346,
      "pose_mae_dy": 0.02012495882809162,
      "pose_rmse_dtheta": 0.09583165496587753,
      "pose_rmse_dx": 0.027041520923376083,
      "pose_rmse_dy": 0.04269002377986908,
      "pose_rmse_mean": 0.055187731981277466,
      "rmse_dtheta": 0.014392273500561714,
      "rmse_dx": 0.003345788223668933,
      "rmse_dy": 0.0026960812974721193,
      "rmse_mean": 0.006811381317675114,
      "rotation_flip": 0.005775895435363054,
      "sparse_tokens": 32057.0,
      "step": 11018,
      "turn_loss": 0.05528024211525917,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.5119401598215945,
      "grad_norm": 0.73896324634552,
      "learning_rate": 1.6764395428490399e-07,
      "loss": 0.1236,
      "mae_dtheta": 0.04488243907690048,
      "mae_dx": 0.02369905821979046,
      "mae_dy": 0.016062699258327484,
      "pose_mae_dtheta": 0.3448747992515564,
      "pose_mae_dx": 0.21981945633888245,
      "pose_mae_dy": 0.14818429946899414,
      "pose_rmse_dtheta": 0.4979257881641388,
      "pose_rmse_dx": 0.38193994760513306,
      "pose_rmse_dy": 0.2952025532722473,
      "pose_rmse_mean": 0.3916894793510437,
      "rmse_dtheta": 0.06058080121874809,
      "rmse_dx": 0.037359483540058136,
      "rmse_dy": 0.025275904685258865,
      "rmse_mean": 0.0410720631480217,
      "rotation_flip": 0.025641025975346565,
      "sparse_tokens": 5558.0,
      "step": 11019,
      "turn_loss": 0.5054520964622498,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.5119866195874373,
      "grad_norm": 0.654045820236206,
      "learning_rate": 1.6730461043302727e-07,
      "loss": 0.1261,
      "mae_dtheta": 0.0381159670650959,
      "mae_dx": 0.014659819193184376,
      "mae_dy": 0.014699190855026245,
      "pose_mae_dtheta": 0.2642480134963989,
      "pose_mae_dx": 0.11517664790153503,
      "pose_mae_dy": 0.12988299131393433,
      "pose_rmse_dtheta": 0.478645920753479,
      "pose_rmse_dx": 0.21345630288124084,
      "pose_rmse_dy": 0.2645207643508911,
      "pose_rmse_mean": 0.318874329328537,
      "rmse_dtheta": 0.059189680963754654,
      "rmse_dx": 0.026501784101128578,
      "rmse_dy": 0.028622375801205635,
      "rmse_mean": 0.03810461610555649,
      "rotation_flip": 0.013698630034923553,
      "sparse_tokens": 6737.0,
      "step": 11020,
      "turn_loss": 0.4559444189071655,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.51203307935328,
      "grad_norm": 0.4027196764945984,
      "learning_rate": 1.6696560453413446e-07,
      "loss": 0.1197,
      "mae_dtheta": 0.006417443044483662,
      "mae_dx": 0.0011401589727029204,
      "mae_dy": 0.0007809345843270421,
      "pose_mae_dtheta": 0.04626757279038429,
      "pose_mae_dx": 0.00954907014966011,
      "pose_mae_dy": 0.01239068154245615,
      "pose_rmse_dtheta": 0.17026706039905548,
      "pose_rmse_dx": 0.033777110278606415,
      "pose_rmse_dy": 0.03188997507095337,
      "pose_rmse_mean": 0.07864471524953842,
      "rmse_dtheta": 0.02010018564760685,
      "rmse_dx": 0.004489200655370951,
      "rmse_dy": 0.001904105069115758,
      "rmse_mean": 0.008831163868308067,
      "rotation_flip": 0.0029797377064824104,
      "sparse_tokens": 32089.0,
      "step": 11021,
      "turn_loss": 0.036304157227277756,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5120795391191229,
      "grad_norm": 0.5998222231864929,
      "learning_rate": 1.6662693661192996e-07,
      "loss": 0.1197,
      "mae_dtheta": 0.00698437076061964,
      "mae_dx": 0.0012128379894420505,
      "mae_dy": 0.001418126281350851,
      "pose_mae_dtheta": 0.04423018544912338,
      "pose_mae_dx": 0.014345897361636162,
      "pose_mae_dy": 0.01804327219724655,
      "pose_rmse_dtheta": 0.12488402426242828,
      "pose_rmse_dx": 0.042420584708452225,
      "pose_rmse_dy": 0.04290851950645447,
      "pose_rmse_mean": 0.07007104158401489,
      "rmse_dtheta": 0.01847193017601967,
      "rmse_dx": 0.004530971869826317,
      "rmse_dy": 0.003273676848039031,
      "rmse_mean": 0.00875885970890522,
      "rotation_flip": 0.0014492754125967622,
      "sparse_tokens": 32073.0,
      "step": 11022,
      "turn_loss": 0.05365930125117302,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.5121259988849656,
      "grad_norm": 0.8039273619651794,
      "learning_rate": 1.6628860669009816e-07,
      "loss": 0.2141,
      "mae_dtheta": 0.031889546662569046,
      "mae_dx": 0.009003228507936,
      "mae_dy": 0.0033991471864283085,
      "pose_mae_dtheta": 0.260258287191391,
      "pose_mae_dx": 0.0746397003531456,
      "pose_mae_dy": 0.04663730412721634,
      "pose_rmse_dtheta": 0.4894199073314667,
      "pose_rmse_dx": 0.19971802830696106,
      "pose_rmse_dy": 0.1272965371608734,
      "pose_rmse_mean": 0.2721448540687561,
      "rmse_dtheta": 0.051901061087846756,
      "rmse_dx": 0.02105552889406681,
      "rmse_dy": 0.007449276279658079,
      "rmse_mean": 0.026801956817507744,
      "rotation_flip": 0.01576872542500496,
      "sparse_tokens": 13963.0,
      "step": 11023,
      "turn_loss": 0.20474489033222198,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 30819.0,
      "epoch": 0.5121724586508084,
      "grad_norm": 0.7761136293411255,
      "learning_rate": 1.6595061479229845e-07,
      "loss": 0.182,
      "mae_dtheta": 0.025504034012556076,
      "mae_dx": 0.008540521375834942,
      "mae_dy": 0.0041669439524412155,
      "pose_mae_dtheta": 0.18005628883838654,
      "pose_mae_dx": 0.07480285316705704,
      "pose_mae_dy": 0.05268734693527222,
      "pose_rmse_dtheta": 0.3266640603542328,
      "pose_rmse_dx": 0.17514032125473022,
      "pose_rmse_dy": 0.12877066433429718,
      "pose_rmse_mean": 0.21019166707992554,
      "rmse_dtheta": 0.04271312057971954,
      "rmse_dx": 0.019331617280840874,
      "rmse_dy": 0.008732056245207787,
      "rmse_mean": 0.0235922671854496,
      "rotation_flip": 0.003508772002533078,
      "sparse_tokens": 24951.0,
      "step": 11024,
      "turn_loss": 0.18955688178539276,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5122189184166511,
      "grad_norm": 0.31796547770500183,
      "learning_rate": 1.656129609421675e-07,
      "loss": 0.0687,
      "mae_dtheta": 0.006909472402185202,
      "mae_dx": 0.0010302503360435367,
      "mae_dy": 0.001572318491525948,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3179655075073242,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.8643341064453,
      "model/head/act_norm_mean": 116.33359966856061,
      "model/head/act_norm_min": 74.0042953491211,
      "model/head/act_over_embed": 79.9455388245545,
      "model/head/grad_frac": 0.10187910497188568,
      "model/head/grad_norm": 0.03239404037594795,
      "model/head/grad_zero_frac": 0.00023763655917719007,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.710320983270202,
      "model/head/update_ratio": 0.0005514412187039852,
      "model/head/weight_delta": 9.981712341308594,
      "model/head/weight_delta_rel": 0.17510880529880524,
      "model/head/weight_norm": 58.74432373046875,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42290860414505005,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228487498199885,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227820932865143,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29058561964866336,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09894972294569016,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03146259859204292,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5281898041474654,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0010159093653783202,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1558585166931152,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10311173647642136,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96988868713379,
      "model/modality_embedder/grad_frac": 0.09894972294569016,
      "model/modality_embedder/grad_norm": 0.03146259859204292,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5281898041474654,
      "model/modality_embedder/update_ratio": 0.0010159093653783202,
      "model/modality_embedder/weight_delta": 3.1558585166931152,
      "model/modality_embedder/weight_delta_rel": 0.10311173647642136,
      "model/modality_embedder/weight_norm": 30.96988868713379,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.8431625366211,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.21883267195767,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.812704086303711,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.64340855245314,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05348488688468933,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.017006348818540573,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0006082214531488717,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.74049711227417,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0998653694987297,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960784912109375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.62694549560547,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.19173631152798,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.351612091064453,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.311997042033234,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05384063720703125,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.01711946539580822,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0005750562413595617,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4746124744415283,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12036329507827759,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770071029663086,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.43606567382812,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.966713263588264,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.500617027282715,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.5317778210851,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05251345783472061,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.016697468236088753,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0003429632051847875,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0005431549507193267,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7642531394958496,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1263965666294098,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.74163055419922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.22903442382812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.646830407247073,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.27337646484375,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.686370051711958,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.04815197363495827,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.015310666523873806,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0005111227510496974,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.235530376434326,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11057507246732712,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95496940612793,
      "model/normalizer/grad_frac": 0.18663451075553894,
      "model/normalizer/grad_norm": 0.05934333801269531,
      "model/normalizer/grad_zero_frac": 0.0002753450535237789,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0007544554537162185,
      "model/normalizer/weight_delta": 6.804666042327881,
      "model/normalizer/weight_delta_rel": 0.08764015883207321,
      "model/normalizer/weight_norm": 78.65718078613281,
      "pose_mae_dtheta": 0.045896921306848526,
      "pose_mae_dx": 0.014491175301373005,
      "pose_mae_dy": 0.02200734242796898,
      "pose_rmse_dtheta": 0.10273416340351105,
      "pose_rmse_dx": 0.03924106806516647,
      "pose_rmse_dy": 0.056162308901548386,
      "pose_rmse_mean": 0.0660458505153656,
      "rmse_dtheta": 0.015444871969521046,
      "rmse_dx": 0.003248360939323902,
      "rmse_dy": 0.0035664367023855448,
      "rmse_mean": 0.00741988979279995,
      "rotation_flip": 0.0057416269555687904,
      "sparse_tokens": 32057.0,
      "step": 11025,
      "turn_loss": 0.05893809348344803,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.512265378182494,
      "grad_norm": 0.33188366889953613,
      "learning_rate": 1.652756451633164e-07,
      "loss": 0.0904,
      "mae_dtheta": 0.013098924420773983,
      "mae_dx": 0.002412297297269106,
      "mae_dy": 0.004736080300062895,
      "pose_mae_dtheta": 0.08470777422189713,
      "pose_mae_dx": 0.030019201338291168,
      "pose_mae_dy": 0.03856898471713066,
      "pose_rmse_dtheta": 0.21328407526016235,
      "pose_rmse_dx": 0.06988218426704407,
      "pose_rmse_dy": 0.0776587426662445,
      "pose_rmse_mean": 0.12027500569820404,
      "rmse_dtheta": 0.026635337620973587,
      "rmse_dx": 0.0061012753285467625,
      "rmse_dy": 0.009266771376132965,
      "rmse_mean": 0.014001129195094109,
      "rotation_flip": 0.004026845563203096,
      "sparse_tokens": 32073.0,
      "step": 11026,
      "turn_loss": 0.1304633915424347,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.5123118379483368,
      "grad_norm": 0.48210716247558594,
      "learning_rate": 1.6493866747933462e-07,
      "loss": 0.1652,
      "mae_dtheta": 0.029490981251001358,
      "mae_dx": 0.01120242103934288,
      "mae_dy": 0.002365679247304797,
      "pose_mae_dtheta": 0.20457391440868378,
      "pose_mae_dx": 0.089408740401268,
      "pose_mae_dy": 0.02356870099902153,
      "pose_rmse_dtheta": 0.3810937702655792,
      "pose_rmse_dx": 0.2171470671892166,
      "pose_rmse_dy": 0.08097036182880402,
      "pose_rmse_mean": 0.22640374302864075,
      "rmse_dtheta": 0.04861218482255936,
      "rmse_dx": 0.023949531838297844,
      "rmse_dy": 0.005856486968696117,
      "rmse_mean": 0.026139400899410248,
      "rotation_flip": 0.012224938720464706,
      "sparse_tokens": 22407.0,
      "step": 11027,
      "turn_loss": 0.20146305859088898,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5123582977141795,
      "grad_norm": 0.48817747831344604,
      "learning_rate": 1.6460202791378666e-07,
      "loss": 0.1032,
      "mae_dtheta": 0.008898671716451645,
      "mae_dx": 0.001495600794441998,
      "mae_dy": 0.00177602784242481,
      "pose_mae_dtheta": 0.06132853031158447,
      "pose_mae_dx": 0.01748240552842617,
      "pose_mae_dy": 0.021428752690553665,
      "pose_rmse_dtheta": 0.17646178603172302,
      "pose_rmse_dx": 0.04556792974472046,
      "pose_rmse_dy": 0.05181172117590904,
      "pose_rmse_mean": 0.0912804827094078,
      "rmse_dtheta": 0.020460354164242744,
      "rmse_dx": 0.004937252961099148,
      "rmse_dy": 0.0038867262192070484,
      "rmse_mean": 0.009761444292962551,
      "rotation_flip": 0.002991453045979142,
      "sparse_tokens": 32089.0,
      "step": 11028,
      "turn_loss": 0.05797349661588669,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5124047574800223,
      "grad_norm": 0.39197200536727905,
      "learning_rate": 1.6426572649021477e-07,
      "loss": 0.0768,
      "mae_dtheta": 0.00707645807415247,
      "mae_dx": 0.0015840315027162433,
      "mae_dy": 0.0017439882503822446,
      "pose_mae_dtheta": 0.04902902990579605,
      "pose_mae_dx": 0.016041412949562073,
      "pose_mae_dy": 0.02027869038283825,
      "pose_rmse_dtheta": 0.1207595095038414,
      "pose_rmse_dx": 0.04017843306064606,
      "pose_rmse_dy": 0.04923955723643303,
      "pose_rmse_mean": 0.0700591653585434,
      "rmse_dtheta": 0.01698414608836174,
      "rmse_dx": 0.005366898607462645,
      "rmse_dy": 0.005070485174655914,
      "rmse_mean": 0.009140510112047195,
      "rotation_flip": 0.005144033115357161,
      "sparse_tokens": 32073.0,
      "step": 11029,
      "turn_loss": 0.07155605405569077,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.5124512172458651,
      "grad_norm": 1.023505449295044,
      "learning_rate": 1.6392976323213518e-07,
      "loss": 0.2289,
      "mae_dtheta": 0.03543046489357948,
      "mae_dx": 0.01463208720088005,
      "mae_dy": 0.007080946117639542,
      "pose_mae_dtheta": 0.2887074053287506,
      "pose_mae_dx": 0.11205966770648956,
      "pose_mae_dy": 0.07566645741462708,
      "pose_rmse_dtheta": 0.4868427813053131,
      "pose_rmse_dx": 0.23241668939590454,
      "pose_rmse_dy": 0.16363854706287384,
      "pose_rmse_mean": 0.2942993640899658,
      "rmse_dtheta": 0.05417529493570328,
      "rmse_dx": 0.026998689398169518,
      "rmse_dy": 0.013058187440037727,
      "rmse_mean": 0.03141072392463684,
      "rotation_flip": 0.011520737782120705,
      "sparse_tokens": 7622.0,
      "step": 11030,
      "turn_loss": 0.2518715560436249,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.5124976770117079,
      "grad_norm": 0.3902219533920288,
      "learning_rate": 1.6359413816304405e-07,
      "loss": 0.0798,
      "mae_dtheta": 0.04645896703004837,
      "mae_dx": 0.014469189569354057,
      "mae_dy": 0.003997740335762501,
      "pose_mae_dtheta": 0.3933422267436981,
      "pose_mae_dx": 0.1262836903333664,
      "pose_mae_dy": 0.047807589173316956,
      "pose_rmse_dtheta": 0.6359021663665771,
      "pose_rmse_dx": 0.2377740740776062,
      "pose_rmse_dy": 0.11672456562519073,
      "pose_rmse_mean": 0.3301336169242859,
      "rmse_dtheta": 0.06483352184295654,
      "rmse_dx": 0.025389859452843666,
      "rmse_dy": 0.008173012174665928,
      "rmse_mean": 0.03279879689216614,
      "rotation_flip": 0.013667426072061062,
      "sparse_tokens": 8466.0,
      "step": 11031,
      "turn_loss": 0.34841927886009216,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 12636.0,
      "epoch": 0.5125441367775506,
      "grad_norm": 0.6662225723266602,
      "learning_rate": 1.6325885130640984e-07,
      "loss": 0.1414,
      "mae_dtheta": 0.03161419928073883,
      "mae_dx": 0.00681699113920331,
      "mae_dy": 0.006587122101336718,
      "pose_mae_dtheta": 0.2547376751899719,
      "pose_mae_dx": 0.07489006221294403,
      "pose_mae_dy": 0.09565107524394989,
      "pose_rmse_dtheta": 0.45226091146469116,
      "pose_rmse_dx": 0.20385414361953735,
      "pose_rmse_dy": 0.21886298060417175,
      "pose_rmse_mean": 0.2916593551635742,
      "rmse_dtheta": 0.04885847121477127,
      "rmse_dx": 0.018552284687757492,
      "rmse_dy": 0.012111178599298,
      "rmse_mean": 0.026507310569286346,
      "rotation_flip": 0.006734006572514772,
      "sparse_tokens": 10284.0,
      "step": 11032,
      "turn_loss": 0.22300362586975098,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5125905965433935,
      "grad_norm": 0.42731499671936035,
      "learning_rate": 1.6292390268568103e-07,
      "loss": 0.0953,
      "mae_dtheta": 0.011473622173070908,
      "mae_dx": 0.0017397695919498801,
      "mae_dy": 0.002554582431912422,
      "pose_mae_dtheta": 0.0753190815448761,
      "pose_mae_dx": 0.024366123601794243,
      "pose_mae_dy": 0.036495357751846313,
      "pose_rmse_dtheta": 0.15687063336372375,
      "pose_rmse_dx": 0.06266841292381287,
      "pose_rmse_dy": 0.07969407737255096,
      "pose_rmse_mean": 0.09974437952041626,
      "rmse_dtheta": 0.020734524354338646,
      "rmse_dx": 0.005936757195740938,
      "rmse_dy": 0.004773388616740704,
      "rmse_mean": 0.010481556877493858,
      "rotation_flip": 0.005392912309616804,
      "sparse_tokens": 32057.0,
      "step": 11033,
      "turn_loss": 0.09813570976257324,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18830.0,
      "epoch": 0.5126370563092362,
      "grad_norm": 0.5181450247764587,
      "learning_rate": 1.625892923242789e-07,
      "loss": 0.108,
      "mae_dtheta": 0.026699483394622803,
      "mae_dx": 0.01014766190201044,
      "mae_dy": 0.004444577265530825,
      "pose_mae_dtheta": 0.21251355111598969,
      "pose_mae_dx": 0.06660390645265579,
      "pose_mae_dy": 0.04620493948459625,
      "pose_rmse_dtheta": 0.4113946259021759,
      "pose_rmse_dx": 0.17607802152633667,
      "pose_rmse_dy": 0.14055559039115906,
      "pose_rmse_mean": 0.24267610907554626,
      "rmse_dtheta": 0.04487670212984085,
      "rmse_dx": 0.02217794395983219,
      "rmse_dy": 0.010796548798680305,
      "rmse_mean": 0.025950398296117783,
      "rotation_flip": 0.01484480407088995,
      "sparse_tokens": 14626.0,
      "step": 11034,
      "turn_loss": 0.23370808362960815,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.512683516075079,
      "grad_norm": 0.5056137442588806,
      "learning_rate": 1.6225502024560468e-07,
      "loss": 0.1114,
      "mae_dtheta": 0.01291152834892273,
      "mae_dx": 0.001958587672561407,
      "mae_dy": 0.00343301915563643,
      "pose_mae_dtheta": 0.08172100782394409,
      "pose_mae_dx": 0.02359979785978794,
      "pose_mae_dy": 0.0320671871304512,
      "pose_rmse_dtheta": 0.16744403541088104,
      "pose_rmse_dx": 0.0508732944726944,
      "pose_rmse_dy": 0.06071997061371803,
      "pose_rmse_mean": 0.09301243722438812,
      "rmse_dtheta": 0.024459652602672577,
      "rmse_dx": 0.005831965710967779,
      "rmse_dy": 0.008071746677160263,
      "rmse_mean": 0.012787789106369019,
      "rotation_flip": 0.004100946243852377,
      "sparse_tokens": 32105.0,
      "step": 11035,
      "turn_loss": 0.11233056336641312,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.5127299758409217,
      "grad_norm": 0.6369388103485107,
      "learning_rate": 1.6192108647303307e-07,
      "loss": 0.1211,
      "mae_dtheta": 0.03180919587612152,
      "mae_dx": 0.012264247983694077,
      "mae_dy": 0.00860153790563345,
      "pose_mae_dtheta": 0.251386821269989,
      "pose_mae_dx": 0.09519632160663605,
      "pose_mae_dy": 0.09477537125349045,
      "pose_rmse_dtheta": 0.5089206099510193,
      "pose_rmse_dx": 0.19719445705413818,
      "pose_rmse_dy": 0.2074488401412964,
      "pose_rmse_mean": 0.3045213222503662,
      "rmse_dtheta": 0.052060291171073914,
      "rmse_dx": 0.02563817985355854,
      "rmse_dy": 0.016780387610197067,
      "rmse_mean": 0.03149295598268509,
      "rotation_flip": 0.01698513887822628,
      "sparse_tokens": 9438.0,
      "step": 11036,
      "turn_loss": 0.42349252104759216,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5127764356067646,
      "grad_norm": 0.3802485466003418,
      "learning_rate": 1.61587491029917e-07,
      "loss": 0.0871,
      "mae_dtheta": 0.0057131145149469376,
      "mae_dx": 0.0009398598922416568,
      "mae_dy": 0.0005338704213500023,
      "pose_mae_dtheta": 0.04270607978105545,
      "pose_mae_dx": 0.00802734587341547,
      "pose_mae_dy": 0.007860352285206318,
      "pose_rmse_dtheta": 0.1943608522415161,
      "pose_rmse_dx": 0.021248020231723785,
      "pose_rmse_dy": 0.02427956461906433,
      "pose_rmse_mean": 0.07996281236410141,
      "rmse_dtheta": 0.022427162155508995,
      "rmse_dx": 0.0027432383503764868,
      "rmse_dy": 0.0014073728816583753,
      "rmse_mean": 0.008859258145093918,
      "rotation_flip": 0.0005574136157520115,
      "sparse_tokens": 32169.0,
      "step": 11037,
      "turn_loss": 0.032980501651763916,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15543.0,
      "epoch": 0.5128228953726073,
      "grad_norm": 0.5911039113998413,
      "learning_rate": 1.612542339395845e-07,
      "loss": 0.1326,
      "mae_dtheta": 0.037545301020145416,
      "mae_dx": 0.010015850886702538,
      "mae_dy": 0.005753764417022467,
      "pose_mae_dtheta": 0.31693679094314575,
      "pose_mae_dx": 0.08464118093252182,
      "pose_mae_dy": 0.07936985045671463,
      "pose_rmse_dtheta": 0.5424180626869202,
      "pose_rmse_dx": 0.1747431457042694,
      "pose_rmse_dy": 0.19242574274539948,
      "pose_rmse_mean": 0.30319565534591675,
      "rmse_dtheta": 0.05489470437169075,
      "rmse_dx": 0.020906424149870872,
      "rmse_dy": 0.01127470750361681,
      "rmse_mean": 0.029025278985500336,
      "rotation_flip": 0.014184396713972092,
      "sparse_tokens": 12198.0,
      "step": 11038,
      "turn_loss": 0.2501991093158722,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5128693551384501,
      "grad_norm": 0.4628692865371704,
      "learning_rate": 1.6092131522534027e-07,
      "loss": 0.1401,
      "mae_dtheta": 0.007661920040845871,
      "mae_dx": 0.0017563377041369677,
      "mae_dy": 0.0020233457908034325,
      "pose_mae_dtheta": 0.04892498999834061,
      "pose_mae_dx": 0.02079130709171295,
      "pose_mae_dy": 0.019784074276685715,
      "pose_rmse_dtheta": 0.10823742300271988,
      "pose_rmse_dx": 0.057850491255521774,
      "pose_rmse_dy": 0.041591815650463104,
      "pose_rmse_mean": 0.06922657787799835,
      "rmse_dtheta": 0.01673118770122528,
      "rmse_dx": 0.004694927018135786,
      "rmse_dy": 0.0049966988153755665,
      "rmse_mean": 0.008807605132460594,
      "rotation_flip": 0.003289473708719015,
      "sparse_tokens": 32121.0,
      "step": 11039,
      "turn_loss": 0.0652802586555481,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.5129158149042928,
      "grad_norm": 0.48150503635406494,
      "learning_rate": 1.6058873491046624e-07,
      "loss": 0.1063,
      "mae_dtheta": 0.03679420426487923,
      "mae_dx": 0.014837238006293774,
      "mae_dy": 0.009385245852172375,
      "pose_mae_dtheta": 0.25926968455314636,
      "pose_mae_dx": 0.10987401008605957,
      "pose_mae_dy": 0.12321522831916809,
      "pose_rmse_dtheta": 0.39021027088165283,
      "pose_rmse_dx": 0.17096495628356934,
      "pose_rmse_dy": 0.21703045070171356,
      "pose_rmse_mean": 0.25940191745758057,
      "rmse_dtheta": 0.047317299991846085,
      "rmse_dx": 0.02587965503334999,
      "rmse_dy": 0.014768819324672222,
      "rmse_mean": 0.029321923851966858,
      "rotation_flip": 0.008695651777088642,
      "sparse_tokens": 5877.0,
      "step": 11040,
      "turn_loss": 0.31679782271385193,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.5129622746701357,
      "grad_norm": 0.45242783427238464,
      "learning_rate": 1.6025649301821877e-07,
      "loss": 0.1276,
      "mae_dtheta": 0.036320287734270096,
      "mae_dx": 0.01463950052857399,
      "mae_dy": 0.004297157283872366,
      "pose_mae_dtheta": 0.287898987531662,
      "pose_mae_dx": 0.13098639249801636,
      "pose_mae_dy": 0.05404570698738098,
      "pose_rmse_dtheta": 0.4620459973812103,
      "pose_rmse_dx": 0.27176403999328613,
      "pose_rmse_dy": 0.1226499006152153,
      "pose_rmse_mean": 0.2854866683483124,
      "rmse_dtheta": 0.053946565836668015,
      "rmse_dx": 0.0274164080619812,
      "rmse_dy": 0.008481803350150585,
      "rmse_mean": 0.029948260635137558,
      "rotation_flip": 0.010028652846813202,
      "sparse_tokens": 11841.0,
      "step": 11041,
      "turn_loss": 0.3022550940513611,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.5130087344359785,
      "grad_norm": 0.514975368976593,
      "learning_rate": 1.599245895718332e-07,
      "loss": 0.1126,
      "mae_dtheta": 0.02623540535569191,
      "mae_dx": 0.01207186933606863,
      "mae_dy": 0.0028336632531136274,
      "pose_mae_dtheta": 0.19165492057800293,
      "pose_mae_dx": 0.11529465764760971,
      "pose_mae_dy": 0.03790934756398201,
      "pose_rmse_dtheta": 0.3237815499305725,
      "pose_rmse_dx": 0.22077137231826782,
      "pose_rmse_dy": 0.07723641395568848,
      "pose_rmse_mean": 0.20726311206817627,
      "rmse_dtheta": 0.04416019469499588,
      "rmse_dx": 0.0235975943505764,
      "rmse_dy": 0.005950982216745615,
      "rmse_mean": 0.024569589644670486,
      "rotation_flip": 0.004464285913854837,
      "sparse_tokens": 4117.0,
      "step": 11042,
      "turn_loss": 0.2058173418045044,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.5130551942018212,
      "grad_norm": 0.46311619877815247,
      "learning_rate": 1.595930245945182e-07,
      "loss": 0.0759,
      "mae_dtheta": 0.04049070551991463,
      "mae_dx": 0.012662387453019619,
      "mae_dy": 0.005745606496930122,
      "pose_mae_dtheta": 0.33765172958374023,
      "pose_mae_dx": 0.0911417081952095,
      "pose_mae_dy": 0.07494599372148514,
      "pose_rmse_dtheta": 0.540643572807312,
      "pose_rmse_dx": 0.2172618955373764,
      "pose_rmse_dy": 0.15727822482585907,
      "pose_rmse_mean": 0.3050612509250641,
      "rmse_dtheta": 0.05859838426113129,
      "rmse_dx": 0.02543868124485016,
      "rmse_dy": 0.010926191695034504,
      "rmse_mean": 0.031654421240091324,
      "rotation_flip": 0.013274336233735085,
      "sparse_tokens": 7946.0,
      "step": 11043,
      "turn_loss": 0.23055173456668854,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.513101653967664,
      "grad_norm": 0.646105170249939,
      "learning_rate": 1.5926179810946185e-07,
      "loss": 0.114,
      "mae_dtheta": 0.010281688533723354,
      "mae_dx": 0.002385128056630492,
      "mae_dy": 0.0024537204299122095,
      "pose_mae_dtheta": 0.07326439023017883,
      "pose_mae_dx": 0.025806859135627747,
      "pose_mae_dy": 0.028275683522224426,
      "pose_rmse_dtheta": 0.20698732137680054,
      "pose_rmse_dx": 0.07965448498725891,
      "pose_rmse_dy": 0.0717453733086586,
      "pose_rmse_mean": 0.11946239322423935,
      "rmse_dtheta": 0.02427690289914608,
      "rmse_dx": 0.008336393162608147,
      "rmse_dy": 0.0068543655797839165,
      "rmse_mean": 0.013155887834727764,
      "rotation_flip": 0.007940215058624744,
      "sparse_tokens": 32041.0,
      "step": 11044,
      "turn_loss": 0.09946552664041519,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5131481137335068,
      "grad_norm": 0.6821553111076355,
      "learning_rate": 1.589309101398251e-07,
      "loss": 0.1078,
      "mae_dtheta": 0.008922246284782887,
      "mae_dx": 0.0020702288020402193,
      "mae_dy": 0.0032206533942371607,
      "pose_mae_dtheta": 0.059171054512262344,
      "pose_mae_dx": 0.02779189869761467,
      "pose_mae_dy": 0.02535923756659031,
      "pose_rmse_dtheta": 0.14114853739738464,
      "pose_rmse_dx": 0.07546837627887726,
      "pose_rmse_dy": 0.05845092236995697,
      "pose_rmse_mean": 0.09168928116559982,
      "rmse_dtheta": 0.019511915743350983,
      "rmse_dx": 0.005062144715338945,
      "rmse_dy": 0.007383784279227257,
      "rmse_mean": 0.010652614757418633,
      "rotation_flip": 0.004347825888544321,
      "sparse_tokens": 32121.0,
      "step": 11045,
      "turn_loss": 0.0805722028017044,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5131945734993496,
      "grad_norm": 0.5352036356925964,
      "learning_rate": 1.586003607087483e-07,
      "loss": 0.1024,
      "mae_dtheta": 0.008890672586858273,
      "mae_dx": 0.001263134996406734,
      "mae_dy": 0.0021356719080358744,
      "pose_mae_dtheta": 0.062264032661914825,
      "pose_mae_dx": 0.021471481770277023,
      "pose_mae_dy": 0.029238874092698097,
      "pose_rmse_dtheta": 0.1485210806131363,
      "pose_rmse_dx": 0.06365130096673965,
      "pose_rmse_dy": 0.08150087296962738,
      "pose_rmse_mean": 0.09789109230041504,
      "rmse_dtheta": 0.01932312734425068,
      "rmse_dx": 0.0034527296666055918,
      "rmse_dy": 0.004990526475012302,
      "rmse_mean": 0.009255461394786835,
      "rotation_flip": 0.00542005430907011,
      "sparse_tokens": 32089.0,
      "step": 11046,
      "turn_loss": 0.07697200030088425,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5132410332651923,
      "grad_norm": 0.383858859539032,
      "learning_rate": 1.582701498393474e-07,
      "loss": 0.092,
      "mae_dtheta": 0.009706280194222927,
      "mae_dx": 0.0015219399938359857,
      "mae_dy": 0.0019998992793262005,
      "pose_mae_dtheta": 0.06229247897863388,
      "pose_mae_dx": 0.017025204375386238,
      "pose_mae_dy": 0.01999121718108654,
      "pose_rmse_dtheta": 0.1746649444103241,
      "pose_rmse_dx": 0.0542689748108387,
      "pose_rmse_dy": 0.052429769188165665,
      "pose_rmse_mean": 0.09378790110349655,
      "rmse_dtheta": 0.02316129207611084,
      "rmse_dx": 0.0053330399096012115,
      "rmse_dy": 0.004777425434440374,
      "rmse_mean": 0.011090585961937904,
      "rotation_flip": 0.004975124262273312,
      "sparse_tokens": 32105.0,
      "step": 11047,
      "turn_loss": 0.07385656237602234,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5132874930310352,
      "grad_norm": 0.691210925579071,
      "learning_rate": 1.5794027755471343e-07,
      "loss": 0.1086,
      "mae_dtheta": 0.009875080548226833,
      "mae_dx": 0.0021347375586628914,
      "mae_dy": 0.0021030681673437357,
      "pose_mae_dtheta": 0.06175592169165611,
      "pose_mae_dx": 0.02122572809457779,
      "pose_mae_dy": 0.021798409521579742,
      "pose_rmse_dtheta": 0.16569587588310242,
      "pose_rmse_dx": 0.06061568856239319,
      "pose_rmse_dy": 0.06618167459964752,
      "pose_rmse_mean": 0.09749774634838104,
      "rmse_dtheta": 0.02453889697790146,
      "rmse_dx": 0.006850102916359901,
      "rmse_dy": 0.005573885049670935,
      "rmse_mean": 0.012320960871875286,
      "rotation_flip": 0.004166666883975267,
      "sparse_tokens": 32153.0,
      "step": 11048,
      "turn_loss": 0.09003997594118118,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.5133339527968779,
      "grad_norm": 0.5654844045639038,
      "learning_rate": 1.576107438779151e-07,
      "loss": 0.1383,
      "mae_dtheta": 0.028735490515828133,
      "mae_dx": 0.00855239573866129,
      "mae_dy": 0.004885941278189421,
      "pose_mae_dtheta": 0.22671988606452942,
      "pose_mae_dx": 0.05514313653111458,
      "pose_mae_dy": 0.04765484482049942,
      "pose_rmse_dtheta": 0.4409204125404358,
      "pose_rmse_dx": 0.13717898726463318,
      "pose_rmse_dy": 0.11577888578176498,
      "pose_rmse_mean": 0.2312927544116974,
      "rmse_dtheta": 0.04799100384116173,
      "rmse_dx": 0.018800651654601097,
      "rmse_dy": 0.011398350819945335,
      "rmse_mean": 0.026063336059451103,
      "rotation_flip": 0.00872600357979536,
      "sparse_tokens": 11146.0,
      "step": 11049,
      "turn_loss": 0.2156544178724289,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.5133804125627207,
      "grad_norm": 0.5882007479667664,
      "learning_rate": 1.5728154883199564e-07,
      "loss": 0.0867,
      "mae_dtheta": 0.026063458994030952,
      "mae_dx": 0.007831936702132225,
      "mae_dy": 0.002642604988068342,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5882006287574768,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 144.15350341796875,
      "model/head/act_norm_mean": 120.71779466711956,
      "model/head/act_norm_min": 85.38196563720703,
      "model/head/act_over_embed": 82.95839867304448,
      "model/head/grad_frac": 0.09198840707540512,
      "model/head/grad_norm": 0.05410763993859291,
      "model/head/grad_zero_frac": 0.00015260772488545626,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6935292119565217,
      "model/head/update_ratio": 0.0009210690623149276,
      "model/head/weight_delta": 9.9820556640625,
      "model/head/weight_delta_rel": 0.17511482536792755,
      "model/head/weight_norm": 58.744388580322266,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228505790233612,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228505790233612,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228505790233612,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905868766943464,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09764464944601059,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05743464455008507,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001854532747529447,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156081438064575,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10311901569366455,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969873428344727,
      "model/modality_embedder/grad_frac": 0.09764464944601059,
      "model/modality_embedder/grad_norm": 0.05743464455008507,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.001854532747529447,
      "model/modality_embedder/weight_delta": 3.156081438064575,
      "model/modality_embedder/weight_delta_rel": 0.10311901569366455,
      "model/modality_embedder/weight_norm": 30.969873428344727,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.65129852294922,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.57506793478261,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.114828109741211,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.88821676019351,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.048984162509441376,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02881251461803913,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010304601164534688,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7407000064849854,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09987276047468185,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960824966430664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 82.04051971435547,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.369799754140786,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.69555950164795,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.43436390685297,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.04790777713060379,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.028179384768009186,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00031270174076780677,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009465644834563136,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4748640060424805,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12037200480699539,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77016830444336,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.5942611694336,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.006146480331264,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.07235336303711,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.558876696810483,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.054838698357343674,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03225615620613098,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010492636356502771,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7645418643951416,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12640626728534698,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.741708755493164,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 84.33352661132812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.78622649240856,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.46159839630127,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.78216434648164,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05630376189947128,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.033117908984422684,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.00110558548476547,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2358081340789795,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1105845645070076,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95508575439453,
      "model/normalizer/grad_frac": 0.2178112417459488,
      "model/normalizer/grad_norm": 0.12811671197414398,
      "model/normalizer/grad_zero_frac": 0.0002292572462465614,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0016287965700030327,
      "model/normalizer/weight_delta": 6.805187702178955,
      "model/normalizer/weight_delta_rel": 0.08764687925577164,
      "model/normalizer/weight_norm": 78.65727996826172,
      "pose_mae_dtheta": 0.2202359437942505,
      "pose_mae_dx": 0.07018673419952393,
      "pose_mae_dy": 0.051655180752277374,
      "pose_rmse_dtheta": 0.48739707469940186,
      "pose_rmse_dx": 0.21287453174591064,
      "pose_rmse_dy": 0.14405038952827454,
      "pose_rmse_mean": 0.2814406752586365,
      "rmse_dtheta": 0.04758918285369873,
      "rmse_dx": 0.021074455231428146,
      "rmse_dy": 0.00552336173132062,
      "rmse_mean": 0.02472900226712227,
      "rotation_flip": 0.008771929889917374,
      "sparse_tokens": 6183.0,
      "step": 11050,
      "turn_loss": 0.16688299179077148,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5134268723285634,
      "grad_norm": 0.3538358211517334,
      "learning_rate": 1.569526924399778e-07,
      "loss": 0.0605,
      "mae_dtheta": 0.008238461799919605,
      "mae_dx": 0.001582027180120349,
      "mae_dy": 0.0016371681122109294,
      "pose_mae_dtheta": 0.05583063140511513,
      "pose_mae_dx": 0.017625141888856888,
      "pose_mae_dy": 0.021879905834794044,
      "pose_rmse_dtheta": 0.16057473421096802,
      "pose_rmse_dx": 0.06550876796245575,
      "pose_rmse_dy": 0.05485756695270538,
      "pose_rmse_mean": 0.09364702552556992,
      "rmse_dtheta": 0.020243525505065918,
      "rmse_dx": 0.006325539201498032,
      "rmse_dy": 0.00361409573815763,
      "rmse_mean": 0.010061053559184074,
      "rotation_flip": 0.007187780924141407,
      "sparse_tokens": 32105.0,
      "step": 11051,
      "turn_loss": 0.06598296016454697,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5134733320944063,
      "grad_norm": 0.413625031709671,
      "learning_rate": 1.5662417472485703e-07,
      "loss": 0.0856,
      "mae_dtheta": 0.009342498145997524,
      "mae_dx": 0.00145571562461555,
      "mae_dy": 0.002566918032243848,
      "pose_mae_dtheta": 0.054969727993011475,
      "pose_mae_dx": 0.018238471820950508,
      "pose_mae_dy": 0.024035433307290077,
      "pose_rmse_dtheta": 0.11368446797132492,
      "pose_rmse_dx": 0.04063819348812103,
      "pose_rmse_dy": 0.04877452552318573,
      "pose_rmse_mean": 0.06769905984401703,
      "rmse_dtheta": 0.018530521541833878,
      "rmse_dx": 0.003651287639513612,
      "rmse_dy": 0.005273626651614904,
      "rmse_mean": 0.009151812642812729,
      "rotation_flip": 0.006399461068212986,
      "sparse_tokens": 32153.0,
      "step": 11052,
      "turn_loss": 0.08253346383571625,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.513519791860249,
      "grad_norm": 0.925323486328125,
      "learning_rate": 1.562959957096072e-07,
      "loss": 0.232,
      "mae_dtheta": 0.028849119320511818,
      "mae_dx": 0.006324967369437218,
      "mae_dy": 0.00669525982812047,
      "pose_mae_dtheta": 0.29486384987831116,
      "pose_mae_dx": 0.06456983089447021,
      "pose_mae_dy": 0.08896724879741669,
      "pose_rmse_dtheta": 0.5310874581336975,
      "pose_rmse_dx": 0.1476578712463379,
      "pose_rmse_dy": 0.18917225301265717,
      "pose_rmse_mean": 0.2893058657646179,
      "rmse_dtheta": 0.048464883118867874,
      "rmse_dx": 0.015730377286672592,
      "rmse_dy": 0.011972532607614994,
      "rmse_mean": 0.02538926526904106,
      "rotation_flip": 0.008230452425777912,
      "sparse_tokens": 4554.0,
      "step": 11053,
      "turn_loss": 0.20199540257453918,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5135662516260918,
      "grad_norm": 0.528529703617096,
      "learning_rate": 1.5596815541717825e-07,
      "loss": 0.1711,
      "mae_dtheta": 0.011620801873505116,
      "mae_dx": 0.0016407084185630083,
      "mae_dy": 0.002763405442237854,
      "pose_mae_dtheta": 0.07959137856960297,
      "pose_mae_dx": 0.02203584648668766,
      "pose_mae_dy": 0.034275200217962265,
      "pose_rmse_dtheta": 0.204056516289711,
      "pose_rmse_dx": 0.05986902117729187,
      "pose_rmse_dy": 0.08243303000926971,
      "pose_rmse_mean": 0.11545287072658539,
      "rmse_dtheta": 0.025880690664052963,
      "rmse_dx": 0.005473577883094549,
      "rmse_dy": 0.006597654428333044,
      "rmse_mean": 0.012650640681385994,
      "rotation_flip": 0.0036764706019312143,
      "sparse_tokens": 32041.0,
      "step": 11054,
      "turn_loss": 0.1156119853258133,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5136127113919345,
      "grad_norm": 0.446265310049057,
      "learning_rate": 1.556406538704963e-07,
      "loss": 0.0939,
      "mae_dtheta": 0.00657466659322381,
      "mae_dx": 0.0024681794457137585,
      "mae_dy": 0.001416960614733398,
      "pose_mae_dtheta": 0.043535832315683365,
      "pose_mae_dx": 0.025085588917136192,
      "pose_mae_dy": 0.0176102127879858,
      "pose_rmse_dtheta": 0.09866813570261002,
      "pose_rmse_dx": 0.07371434569358826,
      "pose_rmse_dy": 0.042642489075660706,
      "pose_rmse_mean": 0.07167498767375946,
      "rmse_dtheta": 0.015406581573188305,
      "rmse_dx": 0.007995789870619774,
      "rmse_dy": 0.0035432472359389067,
      "rmse_mean": 0.008981872349977493,
      "rotation_flip": 0.003516998840495944,
      "sparse_tokens": 32089.0,
      "step": 11055,
      "turn_loss": 0.08631201833486557,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.5136591711577774,
      "grad_norm": 0.4711502194404602,
      "learning_rate": 1.5531349109246364e-07,
      "loss": 0.103,
      "mae_dtheta": 0.022894397377967834,
      "mae_dx": 0.0069405511021614075,
      "mae_dy": 0.0035935412161052227,
      "pose_mae_dtheta": 0.14119382202625275,
      "pose_mae_dx": 0.05216978117823601,
      "pose_mae_dy": 0.04338812083005905,
      "pose_rmse_dtheta": 0.25133323669433594,
      "pose_rmse_dx": 0.1179877296090126,
      "pose_rmse_dy": 0.09353014081716537,
      "pose_rmse_mean": 0.15428370237350464,
      "rmse_dtheta": 0.036772627383470535,
      "rmse_dx": 0.01708071492612362,
      "rmse_dy": 0.008078835904598236,
      "rmse_mean": 0.020644059404730797,
      "rotation_flip": 0.004651162773370743,
      "sparse_tokens": 4334.0,
      "step": 11056,
      "turn_loss": 0.16265535354614258,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5137056309236201,
      "grad_norm": 0.3195457458496094,
      "learning_rate": 1.5498666710595855e-07,
      "loss": 0.0678,
      "mae_dtheta": 0.006885255686938763,
      "mae_dx": 0.0008743261569179595,
      "mae_dy": 0.0014429619768634439,
      "pose_mae_dtheta": 0.04223555326461792,
      "pose_mae_dx": 0.013004307635128498,
      "pose_mae_dy": 0.019651591777801514,
      "pose_rmse_dtheta": 0.08842530101537704,
      "pose_rmse_dx": 0.03278091177344322,
      "pose_rmse_dy": 0.04969589412212372,
      "pose_rmse_mean": 0.056967370212078094,
      "rmse_dtheta": 0.015645595267415047,
      "rmse_dx": 0.0025256879162043333,
      "rmse_dy": 0.003193917917087674,
      "rmse_mean": 0.007121733855456114,
      "rotation_flip": 0.004139072727411985,
      "sparse_tokens": 32105.0,
      "step": 11057,
      "turn_loss": 0.05984360724687576,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.5137520906894629,
      "grad_norm": 0.6936230659484863,
      "learning_rate": 1.5466018193383615e-07,
      "loss": 0.1417,
      "mae_dtheta": 0.023293327540159225,
      "mae_dx": 0.008585052564740181,
      "mae_dy": 0.004923404194414616,
      "pose_mae_dtheta": 0.1574297994375229,
      "pose_mae_dx": 0.067108154296875,
      "pose_mae_dy": 0.07869227230548859,
      "pose_rmse_dtheta": 0.29812219738960266,
      "pose_rmse_dx": 0.14842495322227478,
      "pose_rmse_dy": 0.1739686131477356,
      "pose_rmse_mean": 0.20683859288692474,
      "rmse_dtheta": 0.03952174261212349,
      "rmse_dx": 0.020313363522291183,
      "rmse_dy": 0.008736738935112953,
      "rmse_mean": 0.02285728231072426,
      "rotation_flip": 0.011965812183916569,
      "sparse_tokens": 10408.0,
      "step": 11058,
      "turn_loss": 0.20039016008377075,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.5137985504553058,
      "grad_norm": 0.9531451463699341,
      "learning_rate": 1.543340355989287e-07,
      "loss": 0.2987,
      "mae_dtheta": 0.03512704372406006,
      "mae_dx": 0.013367369771003723,
      "mae_dy": 0.009853539988398552,
      "pose_mae_dtheta": 0.2684953510761261,
      "pose_mae_dx": 0.10257944464683533,
      "pose_mae_dy": 0.1174505278468132,
      "pose_rmse_dtheta": 0.47332528233528137,
      "pose_rmse_dx": 0.2170519083738327,
      "pose_rmse_dy": 0.25384894013404846,
      "pose_rmse_mean": 0.3147420585155487,
      "rmse_dtheta": 0.052595894783735275,
      "rmse_dx": 0.026144636794924736,
      "rmse_dy": 0.016523588448762894,
      "rmse_mean": 0.03175470978021622,
      "rotation_flip": 0.018292682245373726,
      "sparse_tokens": 8475.0,
      "step": 11059,
      "turn_loss": 0.29926154017448425,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5138450102211485,
      "grad_norm": 0.28570643067359924,
      "learning_rate": 1.5400822812404183e-07,
      "loss": 0.098,
      "mae_dtheta": 0.009323651902377605,
      "mae_dx": 0.0011247958755120635,
      "mae_dy": 0.0021780976094305515,
      "pose_mae_dtheta": 0.06296607851982117,
      "pose_mae_dx": 0.019425634294748306,
      "pose_mae_dy": 0.028589045628905296,
      "pose_rmse_dtheta": 0.15368223190307617,
      "pose_rmse_dx": 0.05851910635828972,
      "pose_rmse_dy": 0.07106898725032806,
      "pose_rmse_mean": 0.09442344307899475,
      "rmse_dtheta": 0.019815631210803986,
      "rmse_dx": 0.0036553628742694855,
      "rmse_dy": 0.004730287939310074,
      "rmse_mean": 0.009400427341461182,
      "rotation_flip": 0.003630496095865965,
      "sparse_tokens": 32073.0,
      "step": 11060,
      "turn_loss": 0.07210372388362885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.5138914699869913,
      "grad_norm": 0.8637926578521729,
      "learning_rate": 1.5368275953196177e-07,
      "loss": 0.1147,
      "mae_dtheta": 0.015968933701515198,
      "mae_dx": 0.006978731602430344,
      "mae_dy": 0.0028915258590132,
      "pose_mae_dtheta": 0.10854649543762207,
      "pose_mae_dx": 0.05343353748321533,
      "pose_mae_dy": 0.04984278231859207,
      "pose_rmse_dtheta": 0.21587017178535461,
      "pose_rmse_dx": 0.13011810183525085,
      "pose_rmse_dy": 0.12333249300718307,
      "pose_rmse_mean": 0.15644025802612305,
      "rmse_dtheta": 0.030810335651040077,
      "rmse_dx": 0.017866050824522972,
      "rmse_dy": 0.005656733643263578,
      "rmse_mean": 0.01811104081571102,
      "rotation_flip": 0.014423076994717121,
      "sparse_tokens": 9101.0,
      "step": 11061,
      "turn_loss": 0.16300733387470245,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.513937929752834,
      "grad_norm": 0.39713215827941895,
      "learning_rate": 1.5335762984544645e-07,
      "loss": 0.0866,
      "mae_dtheta": 0.009657153859734535,
      "mae_dx": 0.002300436142832041,
      "mae_dy": 0.00201304629445076,
      "pose_mae_dtheta": 0.06591133028268814,
      "pose_mae_dx": 0.02567368373274803,
      "pose_mae_dy": 0.023529917001724243,
      "pose_rmse_dtheta": 0.16399244964122772,
      "pose_rmse_dx": 0.08251126110553741,
      "pose_rmse_dy": 0.06172139570116997,
      "pose_rmse_mean": 0.10274170339107513,
      "rmse_dtheta": 0.022634655237197876,
      "rmse_dx": 0.008353972807526588,
      "rmse_dy": 0.004710519686341286,
      "rmse_mean": 0.011899716220796108,
      "rotation_flip": 0.002572898752987385,
      "sparse_tokens": 32121.0,
      "step": 11062,
      "turn_loss": 0.09396971762180328,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5139843895186769,
      "grad_norm": 0.4092586636543274,
      "learning_rate": 1.5303283908723432e-07,
      "loss": 0.1247,
      "mae_dtheta": 0.009231028147041798,
      "mae_dx": 0.001071529695764184,
      "mae_dy": 0.0020539681427180767,
      "pose_mae_dtheta": 0.057769566774368286,
      "pose_mae_dx": 0.01655201055109501,
      "pose_mae_dy": 0.027437740936875343,
      "pose_rmse_dtheta": 0.14885848760604858,
      "pose_rmse_dx": 0.03670942783355713,
      "pose_rmse_dy": 0.05900508537888527,
      "pose_rmse_mean": 0.0815243348479271,
      "rmse_dtheta": 0.02078069932758808,
      "rmse_dx": 0.0030631821136921644,
      "rmse_dy": 0.004800543189048767,
      "rmse_mean": 0.009548141621053219,
      "rotation_flip": 0.00932964775711298,
      "sparse_tokens": 32105.0,
      "step": 11063,
      "turn_loss": 0.08056621253490448,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12314.0,
      "epoch": 0.5140308492845196,
      "grad_norm": 0.5919162631034851,
      "learning_rate": 1.5270838728003668e-07,
      "loss": 0.1198,
      "mae_dtheta": 0.029491430148482323,
      "mae_dx": 0.01460277009755373,
      "mae_dy": 0.006316726561635733,
      "pose_mae_dtheta": 0.20373375713825226,
      "pose_mae_dx": 0.11040819436311722,
      "pose_mae_dy": 0.09596843272447586,
      "pose_rmse_dtheta": 0.38235196471214294,
      "pose_rmse_dx": 0.2316928505897522,
      "pose_rmse_dy": 0.19232283532619476,
      "pose_rmse_mean": 0.26878923177719116,
      "rmse_dtheta": 0.04567474499344826,
      "rmse_dx": 0.028841689229011536,
      "rmse_dy": 0.01063914131373167,
      "rmse_mean": 0.028385190293192863,
      "rotation_flip": 0.014953271485865116,
      "sparse_tokens": 10233.0,
      "step": 11064,
      "turn_loss": 0.270717591047287,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.5140773090503624,
      "grad_norm": 0.572999894618988,
      "learning_rate": 1.5238427444654368e-07,
      "loss": 0.1397,
      "mae_dtheta": 0.03596071898937225,
      "mae_dx": 0.005947838071733713,
      "mae_dy": 0.00827285647392273,
      "pose_mae_dtheta": 0.2801409661769867,
      "pose_mae_dx": 0.05136533081531525,
      "pose_mae_dy": 0.11369405686855316,
      "pose_rmse_dtheta": 0.5357590317726135,
      "pose_rmse_dx": 0.11170852184295654,
      "pose_rmse_dy": 0.2575962245464325,
      "pose_rmse_mean": 0.30168792605400085,
      "rmse_dtheta": 0.05676689371466637,
      "rmse_dx": 0.014675753191113472,
      "rmse_dy": 0.016238870099186897,
      "rmse_mean": 0.02922717295587063,
      "rotation_flip": 0.012269938364624977,
      "sparse_tokens": 8875.0,
      "step": 11065,
      "turn_loss": 0.22503012418746948,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.5141237688162051,
      "grad_norm": 0.50675368309021,
      "learning_rate": 1.5206050060942002e-07,
      "loss": 0.1246,
      "mae_dtheta": 0.02747800201177597,
      "mae_dx": 0.009998682886362076,
      "mae_dy": 0.003945949487388134,
      "pose_mae_dtheta": 0.1923212707042694,
      "pose_mae_dx": 0.07471945881843567,
      "pose_mae_dy": 0.04251770302653313,
      "pose_rmse_dtheta": 0.3918350636959076,
      "pose_rmse_dx": 0.19560709595680237,
      "pose_rmse_dy": 0.11583787202835083,
      "pose_rmse_mean": 0.23442667722702026,
      "rmse_dtheta": 0.04699810966849327,
      "rmse_dx": 0.022493567317724228,
      "rmse_dy": 0.009217578917741776,
      "rmse_mean": 0.02623642049729824,
      "rotation_flip": 0.015197568573057652,
      "sparse_tokens": 12650.0,
      "step": 11066,
      "turn_loss": 0.23464782536029816,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.514170228582048,
      "grad_norm": 0.48410311341285706,
      "learning_rate": 1.5173706579130752e-07,
      "loss": 0.1105,
      "mae_dtheta": 0.007244084030389786,
      "mae_dx": 0.002033818978816271,
      "mae_dy": 0.0014729804825037718,
      "pose_mae_dtheta": 0.05307933688163757,
      "pose_mae_dx": 0.021198028698563576,
      "pose_mae_dy": 0.014987356960773468,
      "pose_rmse_dtheta": 0.14777560532093048,
      "pose_rmse_dx": 0.06647831946611404,
      "pose_rmse_dy": 0.04453377425670624,
      "pose_rmse_mean": 0.08626256883144379,
      "rmse_dtheta": 0.018234828487038612,
      "rmse_dx": 0.006907978560775518,
      "rmse_dy": 0.004092194139957428,
      "rmse_mean": 0.00974500086158514,
      "rotation_flip": 0.003970880061388016,
      "sparse_tokens": 32073.0,
      "step": 11067,
      "turn_loss": 0.05768882483243942,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8759.0,
      "epoch": 0.5142166883478907,
      "grad_norm": 0.560533344745636,
      "learning_rate": 1.5141397001482427e-07,
      "loss": 0.1212,
      "mae_dtheta": 0.03827320411801338,
      "mae_dx": 0.010458609089255333,
      "mae_dy": 0.010425889864563942,
      "pose_mae_dtheta": 0.3129822909832001,
      "pose_mae_dx": 0.0979498103260994,
      "pose_mae_dy": 0.1318398416042328,
      "pose_rmse_dtheta": 0.47903701663017273,
      "pose_rmse_dx": 0.17572537064552307,
      "pose_rmse_dy": 0.24747644364833832,
      "pose_rmse_mean": 0.30074629187583923,
      "rmse_dtheta": 0.05306475982069969,
      "rmse_dx": 0.020283928140997887,
      "rmse_dy": 0.018032122403383255,
      "rmse_mean": 0.030460268259048462,
      "rotation_flip": 0.017676766961812973,
      "sparse_tokens": 7212.0,
      "step": 11068,
      "turn_loss": 0.41073858737945557,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.5142631481137335,
      "grad_norm": 0.4939802587032318,
      "learning_rate": 1.5109121330256492e-07,
      "loss": 0.1513,
      "mae_dtheta": 0.04191701114177704,
      "mae_dx": 0.01086491160094738,
      "mae_dy": 0.0026568772736936808,
      "pose_mae_dtheta": 0.3270408809185028,
      "pose_mae_dx": 0.08321526646614075,
      "pose_mae_dy": 0.02749856375157833,
      "pose_rmse_dtheta": 0.5935061573982239,
      "pose_rmse_dx": 0.21768131852149963,
      "pose_rmse_dy": 0.08133972436189651,
      "pose_rmse_mean": 0.2975090742111206,
      "rmse_dtheta": 0.06452919542789459,
      "rmse_dx": 0.023699168115854263,
      "rmse_dy": 0.006324477028101683,
      "rmse_mean": 0.03151761367917061,
      "rotation_flip": 0.011782032437622547,
      "sparse_tokens": 11907.0,
      "step": 11069,
      "turn_loss": 0.2567516565322876,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5143096078795762,
      "grad_norm": 0.601942241191864,
      "learning_rate": 1.5076879567709867e-07,
      "loss": 0.1217,
      "mae_dtheta": 0.004960918799042702,
      "mae_dx": 0.0023865890689194202,
      "mae_dy": 0.0017055420903488994,
      "pose_mae_dtheta": 0.03618739917874336,
      "pose_mae_dx": 0.01969798281788826,
      "pose_mae_dy": 0.013975916430354118,
      "pose_rmse_dtheta": 0.11826550215482712,
      "pose_rmse_dx": 0.07948556542396545,
      "pose_rmse_dy": 0.04918604716658592,
      "pose_rmse_mean": 0.08231237530708313,
      "rmse_dtheta": 0.015406562946736813,
      "rmse_dx": 0.009706234559416771,
      "rmse_dy": 0.007117013446986675,
      "rmse_mean": 0.010743270628154278,
      "rotation_flip": 0.0051165432669222355,
      "sparse_tokens": 32089.0,
      "step": 11070,
      "turn_loss": 0.07247602939605713,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.5143560676454191,
      "grad_norm": 0.5587449073791504,
      "learning_rate": 1.5044671716097414e-07,
      "loss": 0.1366,
      "mae_dtheta": 0.023395871743559837,
      "mae_dx": 0.01022628415375948,
      "mae_dy": 0.006274590268731117,
      "pose_mae_dtheta": 0.15470179915428162,
      "pose_mae_dx": 0.052177544683218,
      "pose_mae_dy": 0.07285860925912857,
      "pose_rmse_dtheta": 0.30964118242263794,
      "pose_rmse_dx": 0.1301950067281723,
      "pose_rmse_dy": 0.15502722561359406,
      "pose_rmse_mean": 0.19828781485557556,
      "rmse_dtheta": 0.03955182060599327,
      "rmse_dx": 0.022059790790081024,
      "rmse_dy": 0.010809637606143951,
      "rmse_mean": 0.02414041757583618,
      "rotation_flip": 0.012787723913788795,
      "sparse_tokens": 6250.0,
      "step": 11071,
      "turn_loss": 0.251462459564209,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5144025274112618,
      "grad_norm": 0.44985947012901306,
      "learning_rate": 1.501249777767133e-07,
      "loss": 0.1205,
      "mae_dtheta": 0.010943826287984848,
      "mae_dx": 0.0014702263288199902,
      "mae_dy": 0.002939508529379964,
      "pose_mae_dtheta": 0.06569927930831909,
      "pose_mae_dx": 0.02154514752328396,
      "pose_mae_dy": 0.02916480228304863,
      "pose_rmse_dtheta": 0.19215847551822662,
      "pose_rmse_dx": 0.06729200482368469,
      "pose_rmse_dy": 0.05955267697572708,
      "pose_rmse_mean": 0.106334388256073,
      "rmse_dtheta": 0.02418161742389202,
      "rmse_dx": 0.00425585824996233,
      "rmse_dy": 0.006253550294786692,
      "rmse_mean": 0.011563676409423351,
      "rotation_flip": 0.007988885045051575,
      "sparse_tokens": 32089.0,
      "step": 11072,
      "turn_loss": 0.0941442996263504,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5144489871771046,
      "grad_norm": 0.4210126996040344,
      "learning_rate": 1.4980357754681595e-07,
      "loss": 0.0961,
      "mae_dtheta": 0.011378062888979912,
      "mae_dx": 0.0030930154025554657,
      "mae_dy": 0.003180901287123561,
      "pose_mae_dtheta": 0.08746357262134552,
      "pose_mae_dx": 0.024431416764855385,
      "pose_mae_dy": 0.024731673300266266,
      "pose_rmse_dtheta": 0.2687126398086548,
      "pose_rmse_dx": 0.07362049072980881,
      "pose_rmse_dy": 0.06685882806777954,
      "pose_rmse_mean": 0.1363973319530487,
      "rmse_dtheta": 0.029305387288331985,
      "rmse_dx": 0.010278581641614437,
      "rmse_dy": 0.010185344144701958,
      "rmse_mean": 0.016589771956205368,
      "rotation_flip": 0.00599700165912509,
      "sparse_tokens": 32121.0,
      "step": 11073,
      "turn_loss": 0.11215707659721375,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.5144954469429474,
      "grad_norm": 0.6656681895256042,
      "learning_rate": 1.4948251649375746e-07,
      "loss": 0.1419,
      "mae_dtheta": 0.03305698558688164,
      "mae_dx": 0.0077251261100173,
      "mae_dy": 0.006346171256154776,
      "pose_mae_dtheta": 0.24427556991577148,
      "pose_mae_dx": 0.05142119154334068,
      "pose_mae_dy": 0.05538937449455261,
      "pose_rmse_dtheta": 0.4628978967666626,
      "pose_rmse_dx": 0.11197596043348312,
      "pose_rmse_dy": 0.11261453479528427,
      "pose_rmse_mean": 0.22916279733181,
      "rmse_dtheta": 0.05206786096096039,
      "rmse_dx": 0.018689708784222603,
      "rmse_dy": 0.01245533861219883,
      "rmse_mean": 0.027737636119127274,
      "rotation_flip": 0.011340206488966942,
      "sparse_tokens": 16208.0,
      "step": 11074,
      "turn_loss": 0.2737872302532196,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 15591.0,
      "epoch": 0.5145419067087902,
      "grad_norm": 0.5502128005027771,
      "learning_rate": 1.4916179463999037e-07,
      "loss": 0.1362,
      "mae_dtheta": 0.03617650642991066,
      "mae_dx": 0.010419730097055435,
      "mae_dy": 0.004022842738777399,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5502127408981323,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 140.35064697265625,
      "model/head/act_norm_mean": 99.89756266276042,
      "model/head/act_norm_min": 61.94772720336914,
      "model/head/act_over_embed": 68.6505403175658,
      "model/head/grad_frac": 0.11674898117780685,
      "model/head/grad_norm": 0.06423677504062653,
      "model/head/grad_zero_frac": 0.0002036884834524244,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6921183268229166,
      "model/head/update_ratio": 0.0010934955207630992,
      "model/head/weight_delta": 9.98239517211914,
      "model/head/weight_delta_rel": 0.1751207858324051,
      "model/head/weight_norm": 58.74443054199219,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42290183901786804,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42285872478874365,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42279762029647827,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059247454057907,
      "model/modality_embedder.encoders.pose/grad_frac": 0.14769099652767181,
      "model/modality_embedder.encoders.pose/grad_norm": 0.08126147091388702,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5446428571428571,
      "model/modality_embedder.encoders.pose/update_ratio": 0.002623888198286295,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1562769412994385,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10312540829181671,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969867706298828,
      "model/modality_embedder/grad_frac": 0.14769099652767181,
      "model/modality_embedder/grad_norm": 0.08126147091388702,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5446428571428571,
      "model/modality_embedder/update_ratio": 0.002623888198286295,
      "model/modality_embedder/weight_delta": 3.1562769412994385,
      "model/modality_embedder/weight_delta_rel": 0.10312540829181671,
      "model/modality_embedder/weight_norm": 30.969867706298828,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 71.97937774658203,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.6464275380291,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.257067680358887,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.562837023328626,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08049353957176208,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.044288571923971176,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015839473344385624,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7408854961395264,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09987951815128326,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960886001586914,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.76188659667969,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.482726727843914,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.790156364440918,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.13754965612574,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0785154476761818,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04320019856095314,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014511190820485353,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.475098133087158,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12038011848926544,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770263671875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 73.98224639892578,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.159990906084655,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.229694366455078,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.29018130220741,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08000913262367249,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04402204602956772,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014319939073175192,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7647900581359863,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12641459703445435,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.741783142089844,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.35134887695312,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.982889488260582,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.178895950317383,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.54289427412412,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06708700954914093,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03691212832927704,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012322450056672096,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2360799312591553,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11059385538101196,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95518684387207,
      "model/normalizer/grad_frac": 0.29046332836151123,
      "model/normalizer/grad_norm": 0.15981662273406982,
      "model/normalizer/grad_zero_frac": 0.00022334855748340487,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020318070892244577,
      "model/normalizer/weight_delta": 6.805667877197266,
      "model/normalizer/weight_delta_rel": 0.08765306323766708,
      "model/normalizer/weight_norm": 78.65737915039062,
      "pose_mae_dtheta": 0.2652975916862488,
      "pose_mae_dx": 0.07756774127483368,
      "pose_mae_dy": 0.05414092168211937,
      "pose_rmse_dtheta": 0.47855663299560547,
      "pose_rmse_dx": 0.18076804280281067,
      "pose_rmse_dy": 0.12258072942495346,
      "pose_rmse_mean": 0.2606351375579834,
      "rmse_dtheta": 0.05588248372077942,
      "rmse_dx": 0.022546596825122833,
      "rmse_dy": 0.007220072206109762,
      "rmse_mean": 0.028549719601869583,
      "rotation_flip": 0.013404825702309608,
      "sparse_tokens": 11617.0,
      "step": 11075,
      "turn_loss": 0.25533270835876465,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.514588366474633,
      "grad_norm": 1.2505031824111938,
      "learning_rate": 1.4884141200794233e-07,
      "loss": 0.1505,
      "mae_dtheta": 0.04230358079075813,
      "mae_dx": 0.008815469220280647,
      "mae_dy": 0.0055932532995939255,
      "pose_mae_dtheta": 0.34526997804641724,
      "pose_mae_dx": 0.062171075493097305,
      "pose_mae_dy": 0.07268733531236649,
      "pose_rmse_dtheta": 0.6354120373725891,
      "pose_rmse_dx": 0.13705019652843475,
      "pose_rmse_dy": 0.1760311871767044,
      "pose_rmse_mean": 0.316164493560791,
      "rmse_dtheta": 0.0631447359919548,
      "rmse_dx": 0.020169846713542938,
      "rmse_dy": 0.01151282712817192,
      "rmse_mean": 0.03160914033651352,
      "rotation_flip": 0.014880952425301075,
      "sparse_tokens": 5303.0,
      "step": 11076,
      "turn_loss": 0.19887515902519226,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 26606.0,
      "epoch": 0.5146348262404757,
      "grad_norm": 0.9595565795898438,
      "learning_rate": 1.4852136862001766e-07,
      "loss": 0.275,
      "mae_dtheta": 0.025049109011888504,
      "mae_dx": 0.008669412694871426,
      "mae_dy": 0.005054069682955742,
      "pose_mae_dtheta": 0.17801451683044434,
      "pose_mae_dx": 0.07324574887752533,
      "pose_mae_dy": 0.07071882486343384,
      "pose_rmse_dtheta": 0.3419620096683502,
      "pose_rmse_dx": 0.1630009412765503,
      "pose_rmse_dy": 0.18857747316360474,
      "pose_rmse_mean": 0.2311801314353943,
      "rmse_dtheta": 0.04243626445531845,
      "rmse_dx": 0.02000134438276291,
      "rmse_dy": 0.010254564695060253,
      "rmse_mean": 0.024230724200606346,
      "rotation_flip": 0.016835017129778862,
      "sparse_tokens": 22151.0,
      "step": 11077,
      "turn_loss": 0.19872763752937317,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.5146812860063186,
      "grad_norm": 0.6764615178108215,
      "learning_rate": 1.4820166449859842e-07,
      "loss": 0.1702,
      "mae_dtheta": 0.015252731740474701,
      "mae_dx": 0.010199190117418766,
      "mae_dy": 0.003291100962087512,
      "pose_mae_dtheta": 0.09716789424419403,
      "pose_mae_dx": 0.07914263010025024,
      "pose_mae_dy": 0.03940880298614502,
      "pose_rmse_dtheta": 0.19537678360939026,
      "pose_rmse_dx": 0.20617854595184326,
      "pose_rmse_dy": 0.10283564776182175,
      "pose_rmse_mean": 0.1681303232908249,
      "rmse_dtheta": 0.02832556515932083,
      "rmse_dx": 0.023669522255659103,
      "rmse_dy": 0.007006168365478516,
      "rmse_mean": 0.019667085260152817,
      "rotation_flip": 0.01044386439025402,
      "sparse_tokens": 9004.0,
      "step": 11078,
      "turn_loss": 0.14287219941616058,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 36874.0,
      "epoch": 0.5147277457721613,
      "grad_norm": 0.3213648498058319,
      "learning_rate": 1.4788229966604061e-07,
      "loss": 0.1029,
      "mae_dtheta": 0.036277640610933304,
      "mae_dx": 0.014524943195283413,
      "mae_dy": 0.005569589789956808,
      "pose_mae_dtheta": 0.291385680437088,
      "pose_mae_dx": 0.12055384367704391,
      "pose_mae_dy": 0.06241270527243614,
      "pose_rmse_dtheta": 0.4916357398033142,
      "pose_rmse_dx": 0.2544915974140167,
      "pose_rmse_dy": 0.1282241940498352,
      "pose_rmse_mean": 0.29145053029060364,
      "rmse_dtheta": 0.053840745240449905,
      "rmse_dx": 0.027193935588002205,
      "rmse_dy": 0.010539337061345577,
      "rmse_mean": 0.03052467480301857,
      "rotation_flip": 0.017942583188414574,
      "sparse_tokens": 29674.0,
      "step": 11079,
      "turn_loss": 0.28839099407196045,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5147742055380041,
      "grad_norm": 0.37440791726112366,
      "learning_rate": 1.4756327414467807e-07,
      "loss": 0.0905,
      "mae_dtheta": 0.014825214631855488,
      "mae_dx": 0.002495600376278162,
      "mae_dy": 0.003608111757785082,
      "pose_mae_dtheta": 0.10702179372310638,
      "pose_mae_dx": 0.02840309403836727,
      "pose_mae_dy": 0.03688385337591171,
      "pose_rmse_dtheta": 0.26749148964881897,
      "pose_rmse_dx": 0.07263756543397903,
      "pose_rmse_dy": 0.0821048691868782,
      "pose_rmse_mean": 0.1407446414232254,
      "rmse_dtheta": 0.030499262735247612,
      "rmse_dx": 0.008702849969267845,
      "rmse_dy": 0.00876140221953392,
      "rmse_mean": 0.015987839549779892,
      "rotation_flip": 0.005045408848673105,
      "sparse_tokens": 32105.0,
      "step": 11080,
      "turn_loss": 0.13250677287578583,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.5148206653038468,
      "grad_norm": 0.4237158000469208,
      "learning_rate": 1.4724458795681962e-07,
      "loss": 0.119,
      "mae_dtheta": 0.035125259310007095,
      "mae_dx": 0.013706471771001816,
      "mae_dy": 0.005730367265641689,
      "pose_mae_dtheta": 0.2838018238544464,
      "pose_mae_dx": 0.1342395544052124,
      "pose_mae_dy": 0.07373661547899246,
      "pose_rmse_dtheta": 0.49970531463623047,
      "pose_rmse_dx": 0.28926917910575867,
      "pose_rmse_dy": 0.1795417070388794,
      "pose_rmse_mean": 0.32283875346183777,
      "rmse_dtheta": 0.052240706980228424,
      "rmse_dx": 0.027180032804608345,
      "rmse_dy": 0.011643900536000729,
      "rmse_mean": 0.030354879796504974,
      "rotation_flip": 0.01534526888281107,
      "sparse_tokens": 12615.0,
      "step": 11081,
      "turn_loss": 0.22091282904148102,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.5148671250696897,
      "grad_norm": 0.4774239659309387,
      "learning_rate": 1.469262411247524e-07,
      "loss": 0.1028,
      "mae_dtheta": 0.04092444106936455,
      "mae_dx": 0.014692610129714012,
      "mae_dy": 0.007726134266704321,
      "pose_mae_dtheta": 0.3307311534881592,
      "pose_mae_dx": 0.12008481472730637,
      "pose_mae_dy": 0.0800110250711441,
      "pose_rmse_dtheta": 0.5548049211502075,
      "pose_rmse_dx": 0.25152090191841125,
      "pose_rmse_dy": 0.2108651101589203,
      "pose_rmse_mean": 0.3390636444091797,
      "rmse_dtheta": 0.05903778225183487,
      "rmse_dx": 0.028184395283460617,
      "rmse_dy": 0.01773148961365223,
      "rmse_mean": 0.03498455509543419,
      "rotation_flip": 0.012642225250601768,
      "sparse_tokens": 13345.0,
      "step": 11082,
      "turn_loss": 0.3737277388572693,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 22971.0,
      "epoch": 0.5149135848355324,
      "grad_norm": 0.5677346587181091,
      "learning_rate": 1.466082336707375e-07,
      "loss": 0.1706,
      "mae_dtheta": 0.03669874370098114,
      "mae_dx": 0.012845936231315136,
      "mae_dy": 0.004448791965842247,
      "pose_mae_dtheta": 0.29798832535743713,
      "pose_mae_dx": 0.10544061660766602,
      "pose_mae_dy": 0.06931963562965393,
      "pose_rmse_dtheta": 0.5471773743629456,
      "pose_rmse_dx": 0.2528928816318512,
      "pose_rmse_dy": 0.1985176056623459,
      "pose_rmse_mean": 0.33286264538764954,
      "rmse_dtheta": 0.05739070475101471,
      "rmse_dx": 0.026810964569449425,
      "rmse_dy": 0.009805886074900627,
      "rmse_mean": 0.03133585304021835,
      "rotation_flip": 0.01678183674812317,
      "sparse_tokens": 17764.0,
      "step": 11083,
      "turn_loss": 0.24365608394145966,
      "turns": 71.0,
      "turns_per_sample": 71.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5149600446013752,
      "grad_norm": 0.4697803556919098,
      "learning_rate": 1.4629056561701382e-07,
      "loss": 0.1114,
      "mae_dtheta": 0.004906147252768278,
      "mae_dx": 0.0009251453448086977,
      "mae_dy": 0.0008217643480747938,
      "pose_mae_dtheta": 0.033853866159915924,
      "pose_mae_dx": 0.008508763276040554,
      "pose_mae_dy": 0.011664782650768757,
      "pose_rmse_dtheta": 0.13045305013656616,
      "pose_rmse_dx": 0.021790405735373497,
      "pose_rmse_dy": 0.03306277096271515,
      "pose_rmse_mean": 0.06176874041557312,
      "rmse_dtheta": 0.015746289864182472,
      "rmse_dx": 0.0028504652436822653,
      "rmse_dy": 0.002569684525951743,
      "rmse_mean": 0.007055480033159256,
      "rotation_flip": 0.0028063610661774874,
      "sparse_tokens": 32169.0,
      "step": 11084,
      "turn_loss": 0.03419867530465126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.515006504367218,
      "grad_norm": 0.5297638773918152,
      "learning_rate": 1.4597323698579692e-07,
      "loss": 0.1016,
      "mae_dtheta": 0.05887313559651375,
      "mae_dx": 0.010778835043311119,
      "mae_dy": 0.007547436747699976,
      "pose_mae_dtheta": 0.5159429907798767,
      "pose_mae_dx": 0.08855432271957397,
      "pose_mae_dy": 0.10153229534626007,
      "pose_rmse_dtheta": 0.8316318988800049,
      "pose_rmse_dx": 0.20133550465106964,
      "pose_rmse_dy": 0.2328333854675293,
      "pose_rmse_mean": 0.4219336211681366,
      "rmse_dtheta": 0.08027785271406174,
      "rmse_dx": 0.023491814732551575,
      "rmse_dy": 0.017113003879785538,
      "rmse_mean": 0.04029422625899315,
      "rotation_flip": 0.01651376113295555,
      "sparse_tokens": 8687.0,
      "step": 11085,
      "turn_loss": 0.3148145079612732,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.5150529641330608,
      "grad_norm": 0.6693885922431946,
      "learning_rate": 1.4565624779927568e-07,
      "loss": 0.1503,
      "mae_dtheta": 0.026792675256729126,
      "mae_dx": 0.008938782848417759,
      "mae_dy": 0.004560759291052818,
      "pose_mae_dtheta": 0.22843733429908752,
      "pose_mae_dx": 0.06247144564986229,
      "pose_mae_dy": 0.058831993490457535,
      "pose_rmse_dtheta": 0.3835488557815552,
      "pose_rmse_dx": 0.16800923645496368,
      "pose_rmse_dy": 0.13692182302474976,
      "pose_rmse_mean": 0.22949330508708954,
      "rmse_dtheta": 0.04136050119996071,
      "rmse_dx": 0.020503636449575424,
      "rmse_dy": 0.008498947136104107,
      "rmse_mean": 0.02345436066389084,
      "rotation_flip": 0.024193547666072845,
      "sparse_tokens": 6168.0,
      "step": 11086,
      "turn_loss": 0.22911329567432404,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 11057.0,
      "epoch": 0.5150994238989035,
      "grad_norm": 1.0444140434265137,
      "learning_rate": 1.4533959807961962e-07,
      "loss": 0.2454,
      "mae_dtheta": 0.0326654389500618,
      "mae_dx": 0.007134756073355675,
      "mae_dy": 0.00251523545011878,
      "pose_mae_dtheta": 0.23727810382843018,
      "pose_mae_dx": 0.052527256309986115,
      "pose_mae_dy": 0.019060146063566208,
      "pose_rmse_dtheta": 0.43512284755706787,
      "pose_rmse_dx": 0.11259561032056808,
      "pose_rmse_dy": 0.046881068497896194,
      "pose_rmse_mean": 0.19819985330104828,
      "rmse_dtheta": 0.051249902695417404,
      "rmse_dx": 0.015069265849888325,
      "rmse_dy": 0.0058664665557444096,
      "rmse_mean": 0.02406187914311886,
      "rotation_flip": 0.010968921706080437,
      "sparse_tokens": 9058.0,
      "step": 11087,
      "turn_loss": 0.22231528162956238,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.5151458836647463,
      "grad_norm": 1.3620221614837646,
      "learning_rate": 1.450232878489699e-07,
      "loss": 0.2206,
      "mae_dtheta": 0.02806701511144638,
      "mae_dx": 0.006024697795510292,
      "mae_dy": 0.004403689876198769,
      "pose_mae_dtheta": 0.217597097158432,
      "pose_mae_dx": 0.048338789492845535,
      "pose_mae_dy": 0.07041691988706589,
      "pose_rmse_dtheta": 0.39097049832344055,
      "pose_rmse_dx": 0.11582497507333755,
      "pose_rmse_dy": 0.1474400758743286,
      "pose_rmse_mean": 0.21807852387428284,
      "rmse_dtheta": 0.04357077553868294,
      "rmse_dx": 0.015292942523956299,
      "rmse_dy": 0.008919058367609978,
      "rmse_mean": 0.022594258189201355,
      "rotation_flip": 0.012612612918019295,
      "sparse_tokens": 11740.0,
      "step": 11088,
      "turn_loss": 0.23577255010604858,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5151923434305891,
      "grad_norm": 0.5630044937133789,
      "learning_rate": 1.4470731712944885e-07,
      "loss": 0.1166,
      "mae_dtheta": 0.006995677016675472,
      "mae_dx": 0.0013647156301885843,
      "mae_dy": 0.0005400303634814918,
      "pose_mae_dtheta": 0.050131168216466904,
      "pose_mae_dx": 0.01157164666801691,
      "pose_mae_dy": 0.007897429168224335,
      "pose_rmse_dtheta": 0.2019866406917572,
      "pose_rmse_dx": 0.034774355590343475,
      "pose_rmse_dy": 0.025615766644477844,
      "pose_rmse_mean": 0.08745893090963364,
      "rmse_dtheta": 0.024661513045430183,
      "rmse_dx": 0.004520490765571594,
      "rmse_dy": 0.00146772142034024,
      "rmse_mean": 0.010216575115919113,
      "rotation_flip": 0.0019480519695207477,
      "sparse_tokens": 32153.0,
      "step": 11089,
      "turn_loss": 0.05071314051747322,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5152388031964319,
      "grad_norm": 0.4263550937175751,
      "learning_rate": 1.443916859431499e-07,
      "loss": 0.1016,
      "mae_dtheta": 0.010575522668659687,
      "mae_dx": 0.0012089147930964828,
      "mae_dy": 0.0020424453541636467,
      "pose_mae_dtheta": 0.06556762754917145,
      "pose_mae_dx": 0.01915021613240242,
      "pose_mae_dy": 0.02381397783756256,
      "pose_rmse_dtheta": 0.17989477515220642,
      "pose_rmse_dx": 0.050031356513500214,
      "pose_rmse_dy": 0.054009150713682175,
      "pose_rmse_mean": 0.09464509785175323,
      "rmse_dtheta": 0.02409425377845764,
      "rmse_dx": 0.004137070849537849,
      "rmse_dy": 0.004106651991605759,
      "rmse_mean": 0.010779326781630516,
      "rotation_flip": 0.005427974741905928,
      "sparse_tokens": 32057.0,
      "step": 11090,
      "turn_loss": 0.08297134935855865,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5152852629622746,
      "grad_norm": 0.43669095635414124,
      "learning_rate": 1.4407639431214705e-07,
      "loss": 0.0989,
      "mae_dtheta": 0.009344552643597126,
      "mae_dx": 0.0012520974269136786,
      "mae_dy": 0.0017347170505672693,
      "pose_mae_dtheta": 0.06012745201587677,
      "pose_mae_dx": 0.017450347542762756,
      "pose_mae_dy": 0.02388538233935833,
      "pose_rmse_dtheta": 0.15510281920433044,
      "pose_rmse_dx": 0.04428325220942497,
      "pose_rmse_dy": 0.06391280144453049,
      "pose_rmse_mean": 0.08776628971099854,
      "rmse_dtheta": 0.022070229053497314,
      "rmse_dx": 0.003489540657028556,
      "rmse_dy": 0.0037019741721451283,
      "rmse_mean": 0.009753914549946785,
      "rotation_flip": 0.0037515631411224604,
      "sparse_tokens": 32089.0,
      "step": 11091,
      "turn_loss": 0.08727335929870605,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.5153317227281174,
      "grad_norm": 0.6608633995056152,
      "learning_rate": 1.437614422584882e-07,
      "loss": 0.1084,
      "mae_dtheta": 0.026498740538954735,
      "mae_dx": 0.005772316362708807,
      "mae_dy": 0.0034930624533444643,
      "pose_mae_dtheta": 0.1737566441297531,
      "pose_mae_dx": 0.05372472107410431,
      "pose_mae_dy": 0.03878838196396828,
      "pose_rmse_dtheta": 0.3442513048648834,
      "pose_rmse_dx": 0.1171717494726181,
      "pose_rmse_dy": 0.10444807261228561,
      "pose_rmse_mean": 0.18862371146678925,
      "rmse_dtheta": 0.04553094133734703,
      "rmse_dx": 0.013675522059202194,
      "rmse_dy": 0.007018025498837233,
      "rmse_mean": 0.022074829787015915,
      "rotation_flip": 0.002481389557942748,
      "sparse_tokens": 7173.0,
      "step": 11092,
      "turn_loss": 0.1807517260313034,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5153781824939603,
      "grad_norm": 0.36657410860061646,
      "learning_rate": 1.43446829804198e-07,
      "loss": 0.0837,
      "mae_dtheta": 0.009147039614617825,
      "mae_dx": 0.0014574346132576466,
      "mae_dy": 0.0022019450552761555,
      "pose_mae_dtheta": 0.06093871220946312,
      "pose_mae_dx": 0.01457742415368557,
      "pose_mae_dy": 0.027727985754609108,
      "pose_rmse_dtheta": 0.13208727538585663,
      "pose_rmse_dx": 0.03339003399014473,
      "pose_rmse_dy": 0.06565961241722107,
      "pose_rmse_mean": 0.07704564183950424,
      "rmse_dtheta": 0.019011234864592552,
      "rmse_dx": 0.004637988284230232,
      "rmse_dy": 0.005048966966569424,
      "rmse_mean": 0.009566063992679119,
      "rotation_flip": 0.00379048939794302,
      "sparse_tokens": 32121.0,
      "step": 11093,
      "turn_loss": 0.07669666409492493,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.515424642259803,
      "grad_norm": 0.7428393959999084,
      "learning_rate": 1.4313255697127825e-07,
      "loss": 0.1835,
      "mae_dtheta": 0.008904702961444855,
      "mae_dx": 0.0016123667592182755,
      "mae_dy": 0.0017093418864533305,
      "pose_mae_dtheta": 0.05582087114453316,
      "pose_mae_dx": 0.020257679745554924,
      "pose_mae_dy": 0.02441408857703209,
      "pose_rmse_dtheta": 0.12301123887300491,
      "pose_rmse_dx": 0.04880679398775101,
      "pose_rmse_dy": 0.0604206807911396,
      "pose_rmse_mean": 0.07741290330886841,
      "rmse_dtheta": 0.018152933567762375,
      "rmse_dx": 0.005166068207472563,
      "rmse_dy": 0.0036193602718412876,
      "rmse_mean": 0.008979454636573792,
      "rotation_flip": 0.006418485194444656,
      "sparse_tokens": 32089.0,
      "step": 11094,
      "turn_loss": 0.0738040879368782,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5154711020256458,
      "grad_norm": 0.4391055703163147,
      "learning_rate": 1.428186237817053e-07,
      "loss": 0.1125,
      "mae_dtheta": 0.00696116266772151,
      "mae_dx": 0.001138221239671111,
      "mae_dy": 0.0016045543598011136,
      "pose_mae_dtheta": 0.04463453218340874,
      "pose_mae_dx": 0.014594829641282558,
      "pose_mae_dy": 0.02017766609787941,
      "pose_rmse_dtheta": 0.08386489003896713,
      "pose_rmse_dx": 0.030435992404818535,
      "pose_rmse_dy": 0.045920927077531815,
      "pose_rmse_mean": 0.053407274186611176,
      "rmse_dtheta": 0.014210519380867481,
      "rmse_dx": 0.003128140466287732,
      "rmse_dy": 0.0031801785808056593,
      "rmse_mean": 0.006839612498879433,
      "rotation_flip": 0.0033469691406935453,
      "sparse_tokens": 32137.0,
      "step": 11095,
      "turn_loss": 0.061904072761535645,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5155175617914886,
      "grad_norm": 0.4247661232948303,
      "learning_rate": 1.4250503025743268e-07,
      "loss": 0.0877,
      "mae_dtheta": 0.010519412346184254,
      "mae_dx": 0.0013411709805950522,
      "mae_dy": 0.0014570938656106591,
      "pose_mae_dtheta": 0.07162482291460037,
      "pose_mae_dx": 0.013136211782693863,
      "pose_mae_dy": 0.017099613323807716,
      "pose_rmse_dtheta": 0.2459535449743271,
      "pose_rmse_dx": 0.041995491832494736,
      "pose_rmse_dy": 0.04305553808808327,
      "pose_rmse_mean": 0.1103348582983017,
      "rmse_dtheta": 0.028129152953624725,
      "rmse_dx": 0.004783867858350277,
      "rmse_dy": 0.003926738630980253,
      "rmse_mean": 0.012279920279979706,
      "rotation_flip": 0.001406469731591642,
      "sparse_tokens": 32105.0,
      "step": 11096,
      "turn_loss": 0.06981340050697327,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.5155640215573314,
      "grad_norm": 0.5526519417762756,
      "learning_rate": 1.4219177642039118e-07,
      "loss": 0.1266,
      "mae_dtheta": 0.030787378549575806,
      "mae_dx": 0.009083076380193233,
      "mae_dy": 0.003677649889141321,
      "pose_mae_dtheta": 0.200694277882576,
      "pose_mae_dx": 0.07750662416219711,
      "pose_mae_dy": 0.03150293603539467,
      "pose_rmse_dtheta": 0.3647671341896057,
      "pose_rmse_dx": 0.16355642676353455,
      "pose_rmse_dy": 0.06903231889009476,
      "pose_rmse_mean": 0.19911861419677734,
      "rmse_dtheta": 0.0473284088075161,
      "rmse_dx": 0.019505338743329048,
      "rmse_dy": 0.00731798866763711,
      "rmse_mean": 0.024717247113585472,
      "rotation_flip": 0.018518518656492233,
      "sparse_tokens": 11830.0,
      "step": 11097,
      "turn_loss": 0.23509332537651062,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.5156104813231741,
      "grad_norm": 0.4669325351715088,
      "learning_rate": 1.4187886229248548e-07,
      "loss": 0.1221,
      "mae_dtheta": 0.03520360589027405,
      "mae_dx": 0.013498603366315365,
      "mae_dy": 0.004722693469375372,
      "pose_mae_dtheta": 0.27676621079444885,
      "pose_mae_dx": 0.11298490315675735,
      "pose_mae_dy": 0.051143258810043335,
      "pose_rmse_dtheta": 0.5188313126564026,
      "pose_rmse_dx": 0.22911030054092407,
      "pose_rmse_dy": 0.12145671248435974,
      "pose_rmse_mean": 0.28979945182800293,
      "rmse_dtheta": 0.055611204355955124,
      "rmse_dx": 0.025184575468301773,
      "rmse_dy": 0.00970105454325676,
      "rmse_mean": 0.03016561269760132,
      "rotation_flip": 0.014231499284505844,
      "sparse_tokens": 18454.0,
      "step": 11098,
      "turn_loss": 0.29674026370048523,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5156569410890169,
      "grad_norm": 0.3784112334251404,
      "learning_rate": 1.4156628789559924e-07,
      "loss": 0.0664,
      "mae_dtheta": 0.00591228948906064,
      "mae_dx": 0.001581616117618978,
      "mae_dy": 0.0011758253676816821,
      "pose_mae_dtheta": 0.043675970286130905,
      "pose_mae_dx": 0.01192924939095974,
      "pose_mae_dy": 0.01302556786686182,
      "pose_rmse_dtheta": 0.14313830435276031,
      "pose_rmse_dx": 0.031626198440790176,
      "pose_rmse_dy": 0.046151552349328995,
      "pose_rmse_mean": 0.0736386850476265,
      "rmse_dtheta": 0.018495189025998116,
      "rmse_dx": 0.005181242246180773,
      "rmse_dy": 0.004323298577219248,
      "rmse_mean": 0.00933324359357357,
      "rotation_flip": 0.0020554985385388136,
      "sparse_tokens": 32153.0,
      "step": 11099,
      "turn_loss": 0.04784070700407028,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5157034008548597,
      "grad_norm": 0.29476577043533325,
      "learning_rate": 1.4125405325158936e-07,
      "loss": 0.0881,
      "mae_dtheta": 0.009822767227888107,
      "mae_dx": 0.0016826735809445381,
      "mae_dy": 0.002454022178426385,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.2947658598423004,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.01742553710938,
      "model/head/act_norm_mean": 108.08078835227273,
      "model/head/act_norm_min": 51.8109130859375,
      "model/head/act_over_embed": 74.27412962396463,
      "model/head/grad_frac": 0.12380553036928177,
      "model/head/grad_norm": 0.03649364411830902,
      "model/head/grad_zero_frac": 0.00020749573013745248,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7105527935606061,
      "model/head/update_ratio": 0.0006212268490344286,
      "model/head/weight_delta": 9.982723236083984,
      "model/head/weight_delta_rel": 0.17512653768062592,
      "model/head/weight_norm": 58.74447250366211,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42291006445884705,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42285549912822845,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227926433086395,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905902578364739,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09980854392051697,
      "model/modality_embedder.encoders.pose/grad_norm": 0.029420150443911552,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5361907819634704,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009499603766016662,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1564037799835205,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1031295508146286,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969871520996094,
      "model/modality_embedder/grad_frac": 0.09980854392051697,
      "model/modality_embedder/grad_norm": 0.029420150443911552,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5361907819634704,
      "model/modality_embedder/update_ratio": 0.0009499603766016662,
      "model/modality_embedder/weight_delta": 3.1564037799835205,
      "model/modality_embedder/weight_delta_rel": 0.1031295508146286,
      "model/modality_embedder/weight_norm": 30.969871520996094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.03479766845703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.429743867243868,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.044047355651855,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.10113933828803,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07431673258543015,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.021906035020947456,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007834522984921932,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.741044044494629,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09988529980182648,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960905075073242,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.39778900146484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.360590027256695,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.325279235839844,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.740825534167897,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07423418015241623,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.021881701424717903,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007350172381848097,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4752955436706543,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12038695067167282,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77032470703125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.46131896972656,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.116990840949175,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.303763389587402,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.947840617020862,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06983249634504318,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.020584234967827797,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000669583328999579,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7650210857391357,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12642236053943634,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.741857528686523,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.94317626953125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.852513227513228,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.155044555664062,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.140507849284255,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06607146561145782,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.01947561278939247,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006501569296233356,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2362990379333496,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11060134321451187,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95524787902832,
      "model/normalizer/grad_frac": 0.26159197092056274,
      "model/normalizer/grad_norm": 0.07710838317871094,
      "model/normalizer/grad_zero_frac": 0.0002505285374354571,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0009803063003346324,
      "model/normalizer/weight_delta": 6.806081771850586,
      "model/normalizer/weight_delta_rel": 0.08765839040279388,
      "model/normalizer/weight_norm": 78.65744018554688,
      "pose_mae_dtheta": 0.06101737171411514,
      "pose_mae_dx": 0.01720963977277279,
      "pose_mae_dy": 0.023288562893867493,
      "pose_rmse_dtheta": 0.13535495102405548,
      "pose_rmse_dx": 0.041756853461265564,
      "pose_rmse_dy": 0.049089185893535614,
      "pose_rmse_mean": 0.07540033757686615,
      "rmse_dtheta": 0.021964631974697113,
      "rmse_dx": 0.005324364174157381,
      "rmse_dy": 0.006009455770254135,
      "rmse_mean": 0.01109948381781578,
      "rotation_flip": 0.00585774052888155,
      "sparse_tokens": 32073.0,
      "step": 11100,
      "turn_loss": 0.08788950741291046,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12998.0,
      "epoch": 0.5157498606207025,
      "grad_norm": 0.4624249041080475,
      "learning_rate": 1.4094215838229176e-07,
      "loss": 0.126,
      "mae_dtheta": 0.03345850855112076,
      "mae_dx": 0.008958888240158558,
      "mae_dy": 0.0036502820439636707,
      "pose_mae_dtheta": 0.23009835183620453,
      "pose_mae_dx": 0.06606020033359528,
      "pose_mae_dy": 0.03691167011857033,
      "pose_rmse_dtheta": 0.4215643107891083,
      "pose_rmse_dx": 0.16331550478935242,
      "pose_rmse_dy": 0.08064349740743637,
      "pose_rmse_mean": 0.22184109687805176,
      "rmse_dtheta": 0.05161380395293236,
      "rmse_dx": 0.01966303400695324,
      "rmse_dy": 0.007455475628376007,
      "rmse_mean": 0.02624410390853882,
      "rotation_flip": 0.025276461616158485,
      "sparse_tokens": 10875.0,
      "step": 11101,
      "turn_loss": 0.24898776412010193,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 32015.0,
      "epoch": 0.5157963203865452,
      "grad_norm": 0.6205133199691772,
      "learning_rate": 1.4063060330951672e-07,
      "loss": 0.2136,
      "mae_dtheta": 0.03326939418911934,
      "mae_dx": 0.012344803661108017,
      "mae_dy": 0.006478220224380493,
      "pose_mae_dtheta": 0.23729583621025085,
      "pose_mae_dx": 0.08540290594100952,
      "pose_mae_dy": 0.07509080320596695,
      "pose_rmse_dtheta": 0.46216702461242676,
      "pose_rmse_dx": 0.19242702424526215,
      "pose_rmse_dy": 0.1726936548948288,
      "pose_rmse_mean": 0.2757625877857208,
      "rmse_dtheta": 0.053015150129795074,
      "rmse_dx": 0.025376835837960243,
      "rmse_dy": 0.013440791517496109,
      "rmse_mean": 0.03061092458665371,
      "rotation_flip": 0.012422360479831696,
      "sparse_tokens": 26260.0,
      "step": 11102,
      "turn_loss": 0.29810503125190735,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.515842780152388,
      "grad_norm": 0.527976393699646,
      "learning_rate": 1.403193880550524e-07,
      "loss": 0.1608,
      "mae_dtheta": 0.010004858486354351,
      "mae_dx": 0.0019218700472265482,
      "mae_dy": 0.0018954393453896046,
      "pose_mae_dtheta": 0.07099765539169312,
      "pose_mae_dx": 0.02337750233709812,
      "pose_mae_dy": 0.02923959493637085,
      "pose_rmse_dtheta": 0.1813095360994339,
      "pose_rmse_dx": 0.06702470034360886,
      "pose_rmse_dy": 0.07818509638309479,
      "pose_rmse_mean": 0.10883977264165878,
      "rmse_dtheta": 0.023227671161293983,
      "rmse_dx": 0.006120423320680857,
      "rmse_dy": 0.004665067419409752,
      "rmse_mean": 0.011337719857692719,
      "rotation_flip": 0.005154639016836882,
      "sparse_tokens": 32089.0,
      "step": 11103,
      "turn_loss": 0.07453304529190063,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.5158892399182308,
      "grad_norm": 0.6737383008003235,
      "learning_rate": 1.4000851264066083e-07,
      "loss": 0.1498,
      "mae_dtheta": 0.024543320760130882,
      "mae_dx": 0.007257053628563881,
      "mae_dy": 0.00220777397044003,
      "pose_mae_dtheta": 0.1751723289489746,
      "pose_mae_dx": 0.05071995407342911,
      "pose_mae_dy": 0.027800463140010834,
      "pose_rmse_dtheta": 0.3338421881198883,
      "pose_rmse_dx": 0.15119965374469757,
      "pose_rmse_dy": 0.07684347778558731,
      "pose_rmse_mean": 0.1872951239347458,
      "rmse_dtheta": 0.04179253429174423,
      "rmse_dx": 0.0190492682158947,
      "rmse_dy": 0.005183182656764984,
      "rmse_mean": 0.02200832962989807,
      "rotation_flip": 0.00890585221350193,
      "sparse_tokens": 13118.0,
      "step": 11104,
      "turn_loss": 0.1640603244304657,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5159356996840736,
      "grad_norm": 0.5065271854400635,
      "learning_rate": 1.3969797708808296e-07,
      "loss": 0.1159,
      "mae_dtheta": 0.010037223808467388,
      "mae_dx": 0.0016192866023629904,
      "mae_dy": 0.0019245233852416277,
      "pose_mae_dtheta": 0.06646616011857986,
      "pose_mae_dx": 0.02044980227947235,
      "pose_mae_dy": 0.026742488145828247,
      "pose_rmse_dtheta": 0.14147351682186127,
      "pose_rmse_dx": 0.05698050558567047,
      "pose_rmse_dy": 0.07219287753105164,
      "pose_rmse_mean": 0.09021563827991486,
      "rmse_dtheta": 0.02074228599667549,
      "rmse_dx": 0.0059171742759644985,
      "rmse_dy": 0.004671046976000071,
      "rmse_mean": 0.01044350303709507,
      "rotation_flip": 0.003696098458021879,
      "sparse_tokens": 32089.0,
      "step": 11105,
      "turn_loss": 0.08431313186883926,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5159821594499163,
      "grad_norm": 0.3596537709236145,
      "learning_rate": 1.393877814190342e-07,
      "loss": 0.0741,
      "mae_dtheta": 0.007076899986714125,
      "mae_dx": 0.001139504020102322,
      "mae_dy": 0.0012873511295765638,
      "pose_mae_dtheta": 0.0437876433134079,
      "pose_mae_dx": 0.01309873815625906,
      "pose_mae_dy": 0.016780240461230278,
      "pose_rmse_dtheta": 0.12120237201452255,
      "pose_rmse_dx": 0.03379868343472481,
      "pose_rmse_dy": 0.04289182275533676,
      "pose_rmse_mean": 0.06596429646015167,
      "rmse_dtheta": 0.01903574727475643,
      "rmse_dx": 0.00365598127245903,
      "rmse_dy": 0.004194060806185007,
      "rmse_mean": 0.008961929939687252,
      "rotation_flip": 0.0025466892402619123,
      "sparse_tokens": 32137.0,
      "step": 11106,
      "turn_loss": 0.06105540320277214,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30077.0,
      "epoch": 0.5160286192157592,
      "grad_norm": 0.45174193382263184,
      "learning_rate": 1.3907792565520716e-07,
      "loss": 0.1065,
      "mae_dtheta": 0.029031263664364815,
      "mae_dx": 0.010901236906647682,
      "mae_dy": 0.004785540513694286,
      "pose_mae_dtheta": 0.24095892906188965,
      "pose_mae_dx": 0.08356282860040665,
      "pose_mae_dy": 0.058256641030311584,
      "pose_rmse_dtheta": 0.4430972635746002,
      "pose_rmse_dx": 0.18311497569084167,
      "pose_rmse_dy": 0.14752830564975739,
      "pose_rmse_mean": 0.2579135298728943,
      "rmse_dtheta": 0.04720155522227287,
      "rmse_dx": 0.022191861644387245,
      "rmse_dy": 0.01005496084690094,
      "rmse_mean": 0.02648279443383217,
      "rotation_flip": 0.0071428571827709675,
      "sparse_tokens": 22757.0,
      "step": 11107,
      "turn_loss": 0.2330227792263031,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.516075078981602,
      "grad_norm": 0.5963999629020691,
      "learning_rate": 1.38768409818269e-07,
      "loss": 0.1486,
      "mae_dtheta": 0.03771209344267845,
      "mae_dx": 0.012180532328784466,
      "mae_dy": 0.003815975273028016,
      "pose_mae_dtheta": 0.3015749454498291,
      "pose_mae_dx": 0.09810284525156021,
      "pose_mae_dy": 0.04683176428079605,
      "pose_rmse_dtheta": 0.5077912211418152,
      "pose_rmse_dx": 0.22697022557258606,
      "pose_rmse_dy": 0.10371191799640656,
      "pose_rmse_mean": 0.279491126537323,
      "rmse_dtheta": 0.05497841536998749,
      "rmse_dx": 0.02488938719034195,
      "rmse_dy": 0.008121720515191555,
      "rmse_mean": 0.02932984195649624,
      "rotation_flip": 0.01371742133051157,
      "sparse_tokens": 10675.0,
      "step": 11108,
      "turn_loss": 0.3322277367115021,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 18507.0,
      "epoch": 0.5161215387474447,
      "grad_norm": 0.6642280220985413,
      "learning_rate": 1.384592339298657e-07,
      "loss": 0.18,
      "mae_dtheta": 0.03460584953427315,
      "mae_dx": 0.0054747574031353,
      "mae_dy": 0.004423543810844421,
      "pose_mae_dtheta": 0.2690678834915161,
      "pose_mae_dx": 0.04064171016216278,
      "pose_mae_dy": 0.04931455850601196,
      "pose_rmse_dtheta": 0.4982747435569763,
      "pose_rmse_dx": 0.0990871861577034,
      "pose_rmse_dy": 0.12928438186645508,
      "pose_rmse_mean": 0.24221543967723846,
      "rmse_dtheta": 0.055559128522872925,
      "rmse_dx": 0.0127497473731637,
      "rmse_dy": 0.010053402744233608,
      "rmse_mean": 0.026120759546756744,
      "rotation_flip": 0.012944984249770641,
      "sparse_tokens": 14855.0,
      "step": 11109,
      "turn_loss": 0.2021622508764267,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.5161679985132875,
      "grad_norm": 0.39920520782470703,
      "learning_rate": 1.3815039801161723e-07,
      "loss": 0.0926,
      "mae_dtheta": 0.006704011466354132,
      "mae_dx": 0.0011139455018565059,
      "mae_dy": 0.00021604869107250124,
      "pose_mae_dtheta": 0.04705997183918953,
      "pose_mae_dx": 0.008747663348913193,
      "pose_mae_dy": 0.002639839658513665,
      "pose_rmse_dtheta": 0.23208114504814148,
      "pose_rmse_dx": 0.019486749544739723,
      "pose_rmse_dy": 0.0052164955995976925,
      "pose_rmse_mean": 0.08559480309486389,
      "rmse_dtheta": 0.027558747678995132,
      "rmse_dx": 0.0029610584024339914,
      "rmse_dy": 0.00047286623157560825,
      "rmse_mean": 0.010330891236662865,
      "rotation_flip": 0.0024257125332951546,
      "sparse_tokens": 32217.0,
      "step": 11110,
      "turn_loss": 0.03881092369556427,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5162144582791303,
      "grad_norm": 0.46597015857696533,
      "learning_rate": 1.3784190208512127e-07,
      "loss": 0.0733,
      "mae_dtheta": 0.006452697329223156,
      "mae_dx": 0.001677609165199101,
      "mae_dy": 0.0020466409623622894,
      "pose_mae_dtheta": 0.041101276874542236,
      "pose_mae_dx": 0.020989855751395226,
      "pose_mae_dy": 0.018188120797276497,
      "pose_rmse_dtheta": 0.11507433652877808,
      "pose_rmse_dx": 0.056572940200567245,
      "pose_rmse_dy": 0.04814654216170311,
      "pose_rmse_mean": 0.07326461374759674,
      "rmse_dtheta": 0.01705639623105526,
      "rmse_dx": 0.004438444972038269,
      "rmse_dy": 0.005305358208715916,
      "rmse_mean": 0.008933400735259056,
      "rotation_flip": 0.0038626608438789845,
      "sparse_tokens": 32169.0,
      "step": 11111,
      "turn_loss": 0.060061704367399216,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26202.0,
      "epoch": 0.5162609180449731,
      "grad_norm": 0.5525739192962646,
      "learning_rate": 1.3753374617195004e-07,
      "loss": 0.1461,
      "mae_dtheta": 0.03916380554437637,
      "mae_dx": 0.014789313077926636,
      "mae_dy": 0.004275538492947817,
      "pose_mae_dtheta": 0.30879542231559753,
      "pose_mae_dx": 0.11012698709964752,
      "pose_mae_dy": 0.04792608320713043,
      "pose_rmse_dtheta": 0.5530295968055725,
      "pose_rmse_dx": 0.23672302067279816,
      "pose_rmse_dy": 0.09975565969944,
      "pose_rmse_mean": 0.2965027689933777,
      "rmse_dtheta": 0.05849496275186539,
      "rmse_dx": 0.02757493034005165,
      "rmse_dy": 0.008670495823025703,
      "rmse_mean": 0.031580131500959396,
      "rotation_flip": 0.007475083228200674,
      "sparse_tokens": 20440.0,
      "step": 11112,
      "turn_loss": 0.3017893135547638,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.5163073778108158,
      "grad_norm": 0.6174163222312927,
      "learning_rate": 1.372259302936546e-07,
      "loss": 0.1791,
      "mae_dtheta": 0.03498907759785652,
      "mae_dx": 0.009922970086336136,
      "mae_dy": 0.005307863932102919,
      "pose_mae_dtheta": 0.2516897916793823,
      "pose_mae_dx": 0.05900520086288452,
      "pose_mae_dy": 0.05087939649820328,
      "pose_rmse_dtheta": 0.44065284729003906,
      "pose_rmse_dx": 0.1301184594631195,
      "pose_rmse_dy": 0.11713213473558426,
      "pose_rmse_mean": 0.22930115461349487,
      "rmse_dtheta": 0.051798369735479355,
      "rmse_dx": 0.020484769716858864,
      "rmse_dy": 0.010945555754005909,
      "rmse_mean": 0.027742899954319,
      "rotation_flip": 0.01827676221728325,
      "sparse_tokens": 6062.0,
      "step": 11113,
      "turn_loss": 0.2907234728336334,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 12676.0,
      "epoch": 0.5163538375766586,
      "grad_norm": 1.0147582292556763,
      "learning_rate": 1.3691845447175943e-07,
      "loss": 0.2104,
      "mae_dtheta": 0.024495713412761688,
      "mae_dx": 0.006532127037644386,
      "mae_dy": 0.002997335512191057,
      "pose_mae_dtheta": 0.1840321123600006,
      "pose_mae_dx": 0.0606866329908371,
      "pose_mae_dy": 0.031896673142910004,
      "pose_rmse_dtheta": 0.40954428911209106,
      "pose_rmse_dx": 0.1669187843799591,
      "pose_rmse_dy": 0.09612497687339783,
      "pose_rmse_mean": 0.22419604659080505,
      "rmse_dtheta": 0.04524841904640198,
      "rmse_dx": 0.016825679689645767,
      "rmse_dy": 0.00831806380301714,
      "rmse_mean": 0.023464053869247437,
      "rotation_flip": 0.025145066902041435,
      "sparse_tokens": 10271.0,
      "step": 11114,
      "turn_loss": 0.1725119948387146,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5164002973425014,
      "grad_norm": 0.35645177960395813,
      "learning_rate": 1.3661131872776734e-07,
      "loss": 0.088,
      "mae_dtheta": 0.010533049702644348,
      "mae_dx": 0.0014046926517039537,
      "mae_dy": 0.002234906191006303,
      "pose_mae_dtheta": 0.06696632504463196,
      "pose_mae_dx": 0.020268365740776062,
      "pose_mae_dy": 0.026123249903321266,
      "pose_rmse_dtheta": 0.1731521338224411,
      "pose_rmse_dx": 0.057026151567697525,
      "pose_rmse_dy": 0.0678723081946373,
      "pose_rmse_mean": 0.09935019910335541,
      "rmse_dtheta": 0.02204424887895584,
      "rmse_dx": 0.004157164599746466,
      "rmse_dy": 0.005046733655035496,
      "rmse_mean": 0.010416049510240555,
      "rotation_flip": 0.004179331474006176,
      "sparse_tokens": 32089.0,
      "step": 11115,
      "turn_loss": 0.07946125417947769,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15865.0,
      "epoch": 0.5164467571083442,
      "grad_norm": 0.3628992438316345,
      "learning_rate": 1.3630452308315557e-07,
      "loss": 0.0896,
      "mae_dtheta": 0.01067292783409357,
      "mae_dx": 0.0025632448960095644,
      "mae_dy": 0.0023894154001027346,
      "pose_mae_dtheta": 0.08908893167972565,
      "pose_mae_dx": 0.0309152714908123,
      "pose_mae_dy": 0.047874391078948975,
      "pose_rmse_dtheta": 0.1858198493719101,
      "pose_rmse_dx": 0.11231649667024612,
      "pose_rmse_dy": 0.11881467700004578,
      "pose_rmse_mean": 0.13898368179798126,
      "rmse_dtheta": 0.02281719632446766,
      "rmse_dx": 0.010893948376178741,
      "rmse_dy": 0.005144545808434486,
      "rmse_mean": 0.012951895594596863,
      "rotation_flip": 0.003086419776082039,
      "sparse_tokens": 12150.0,
      "step": 11116,
      "turn_loss": 0.07178452610969543,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 19741.0,
      "epoch": 0.5164932168741869,
      "grad_norm": 0.45133379101753235,
      "learning_rate": 1.3599806755937916e-07,
      "loss": 0.1161,
      "mae_dtheta": 0.035660259425640106,
      "mae_dx": 0.013205550611019135,
      "mae_dy": 0.008167999796569347,
      "pose_mae_dtheta": 0.2773072421550751,
      "pose_mae_dx": 0.10190673917531967,
      "pose_mae_dy": 0.07736468315124512,
      "pose_rmse_dtheta": 0.4993399977684021,
      "pose_rmse_dx": 0.2390490174293518,
      "pose_rmse_dy": 0.14979901909828186,
      "pose_rmse_mean": 0.2960626780986786,
      "rmse_dtheta": 0.055013008415699005,
      "rmse_dx": 0.02681685984134674,
      "rmse_dy": 0.01620255969464779,
      "rmse_mean": 0.03267747908830643,
      "rotation_flip": 0.014909477904438972,
      "sparse_tokens": 15901.0,
      "step": 11117,
      "turn_loss": 0.32570165395736694,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.5165396766400298,
      "grad_norm": 0.6585683822631836,
      "learning_rate": 1.356919521778688e-07,
      "loss": 0.0707,
      "mae_dtheta": 0.006448543164879084,
      "mae_dx": 0.0010487143881618977,
      "mae_dy": 0.00040559613262303174,
      "pose_mae_dtheta": 0.044578149914741516,
      "pose_mae_dx": 0.008642280474305153,
      "pose_mae_dy": 0.006070889998227358,
      "pose_rmse_dtheta": 0.20163975656032562,
      "pose_rmse_dx": 0.022032087668776512,
      "pose_rmse_dy": 0.019116083160042763,
      "pose_rmse_mean": 0.08092930912971497,
      "rmse_dtheta": 0.025317909196019173,
      "rmse_dx": 0.0031665812712162733,
      "rmse_dy": 0.0009240004001185298,
      "rmse_mean": 0.009802830405533314,
      "rotation_flip": 0.0005146680632606149,
      "sparse_tokens": 32201.0,
      "step": 11118,
      "turn_loss": 0.03267848864197731,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5165861364058725,
      "grad_norm": 0.5767439603805542,
      "learning_rate": 1.3538617696003066e-07,
      "loss": 0.1166,
      "mae_dtheta": 0.012132134288549423,
      "mae_dx": 0.004055863246321678,
      "mae_dy": 0.003909232560545206,
      "pose_mae_dtheta": 0.08211247622966766,
      "pose_mae_dx": 0.04285934194922447,
      "pose_mae_dy": 0.037117913365364075,
      "pose_rmse_dtheta": 0.1681821495294571,
      "pose_rmse_dx": 0.13063128292560577,
      "pose_rmse_dy": 0.09082330763339996,
      "pose_rmse_mean": 0.1298789232969284,
      "rmse_dtheta": 0.02394500933587551,
      "rmse_dx": 0.012149172835052013,
      "rmse_dy": 0.009742946363985538,
      "rmse_mean": 0.015279042534530163,
      "rotation_flip": 0.002414486836642027,
      "sparse_tokens": 32073.0,
      "step": 11119,
      "turn_loss": 0.1580340713262558,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.5166325961717153,
      "grad_norm": 1.1492674350738525,
      "learning_rate": 1.3508074192724874e-07,
      "loss": 0.2187,
      "mae_dtheta": 0.024976395070552826,
      "mae_dx": 0.007944818586111069,
      "mae_dy": 0.003928821533918381,
      "pose_mae_dtheta": 0.16651220619678497,
      "pose_mae_dx": 0.06191368028521538,
      "pose_mae_dy": 0.04553408920764923,
      "pose_rmse_dtheta": 0.3169611692428589,
      "pose_rmse_dx": 0.16037528216838837,
      "pose_rmse_dy": 0.1254435032606125,
      "pose_rmse_mean": 0.20092666149139404,
      "rmse_dtheta": 0.0408208966255188,
      "rmse_dx": 0.019322793930768967,
      "rmse_dy": 0.00819377787411213,
      "rmse_mean": 0.022779157385230064,
      "rotation_flip": 0.010362694039940834,
      "sparse_tokens": 6349.0,
      "step": 11120,
      "turn_loss": 0.24079257249832153,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.516679055937558,
      "grad_norm": 0.4771890938282013,
      "learning_rate": 1.3477564710088097e-07,
      "loss": 0.0684,
      "mae_dtheta": 0.033982861787080765,
      "mae_dx": 0.007561755832284689,
      "mae_dy": 0.0037470280658453703,
      "pose_mae_dtheta": 0.24844714999198914,
      "pose_mae_dx": 0.0562744177877903,
      "pose_mae_dy": 0.06908000260591507,
      "pose_rmse_dtheta": 0.5033029317855835,
      "pose_rmse_dx": 0.1174037978053093,
      "pose_rmse_dy": 0.15970294177532196,
      "pose_rmse_mean": 0.26013657450675964,
      "rmse_dtheta": 0.05481413006782532,
      "rmse_dx": 0.017548952251672745,
      "rmse_dy": 0.006499384995549917,
      "rmse_mean": 0.026287488639354706,
      "rotation_flip": 0.007092198356986046,
      "sparse_tokens": 7633.0,
      "step": 11121,
      "turn_loss": 0.22506080567836761,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.5167255157034009,
      "grad_norm": 0.44043877720832825,
      "learning_rate": 1.3447089250226364e-07,
      "loss": 0.1124,
      "mae_dtheta": 0.0352865606546402,
      "mae_dx": 0.016188278794288635,
      "mae_dy": 0.005679711699485779,
      "pose_mae_dtheta": 0.29461196064949036,
      "pose_mae_dx": 0.1304551362991333,
      "pose_mae_dy": 0.0843060091137886,
      "pose_rmse_dtheta": 0.5046640634536743,
      "pose_rmse_dx": 0.27365046739578247,
      "pose_rmse_dy": 0.17029277980327606,
      "pose_rmse_mean": 0.31620246171951294,
      "rmse_dtheta": 0.05195433646440506,
      "rmse_dx": 0.03029702976346016,
      "rmse_dy": 0.010175984352827072,
      "rmse_mean": 0.03080911934375763,
      "rotation_flip": 0.007263922598212957,
      "sparse_tokens": 13990.0,
      "step": 11122,
      "turn_loss": 0.32305672764778137,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5167719754692436,
      "grad_norm": 0.6546007990837097,
      "learning_rate": 1.341664781527091e-07,
      "loss": 0.1259,
      "mae_dtheta": 0.006834595929831266,
      "mae_dx": 0.0010116583434864879,
      "mae_dy": 0.001396427396684885,
      "pose_mae_dtheta": 0.04192587360739708,
      "pose_mae_dx": 0.013829272240400314,
      "pose_mae_dy": 0.018093278631567955,
      "pose_rmse_dtheta": 0.09610670804977417,
      "pose_rmse_dx": 0.0348164439201355,
      "pose_rmse_dy": 0.04472152143716812,
      "pose_rmse_mean": 0.0585482232272625,
      "rmse_dtheta": 0.015538223087787628,
      "rmse_dx": 0.003390856087207794,
      "rmse_dy": 0.0031835976988077164,
      "rmse_mean": 0.007370892446488142,
      "rotation_flip": 0.0030721966177225113,
      "sparse_tokens": 32121.0,
      "step": 11123,
      "turn_loss": 0.04923630133271217,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16562.0,
      "epoch": 0.5168184352350864,
      "grad_norm": 0.5564618110656738,
      "learning_rate": 1.3386240407350316e-07,
      "loss": 0.107,
      "mae_dtheta": 0.02852492220699787,
      "mae_dx": 0.0068286750465631485,
      "mae_dy": 0.004220317583531141,
      "pose_mae_dtheta": 0.22100026905536652,
      "pose_mae_dx": 0.05312705039978027,
      "pose_mae_dy": 0.06028338894248009,
      "pose_rmse_dtheta": 0.45543375611305237,
      "pose_rmse_dx": 0.15396979451179504,
      "pose_rmse_dy": 0.1415594071149826,
      "pose_rmse_mean": 0.25032100081443787,
      "rmse_dtheta": 0.0481475330889225,
      "rmse_dx": 0.0182251688092947,
      "rmse_dy": 0.00800024252384901,
      "rmse_mean": 0.02479097992181778,
      "rotation_flip": 0.005673758685588837,
      "sparse_tokens": 13497.0,
      "step": 11124,
      "turn_loss": 0.18478401005268097,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5168648950009292,
      "grad_norm": 0.5324054956436157,
      "learning_rate": 1.3355867028591209e-07,
      "loss": 0.1157,
      "mae_dtheta": 0.00773284025490284,
      "mae_dx": 0.0016730017960071564,
      "mae_dy": 0.002665949985384941,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5324055552482605,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 170.73281860351562,
      "model/head/act_norm_mean": 112.54582938762626,
      "model/head/act_norm_min": 53.89322280883789,
      "model/head/act_over_embed": 77.34254762583234,
      "model/head/grad_frac": 0.10934295505285263,
      "model/head/grad_norm": 0.05821479484438896,
      "model/head/grad_zero_frac": 0.00016910585691221058,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7059659090909091,
      "model/head/update_ratio": 0.000990982516668737,
      "model/head/weight_delta": 9.983051300048828,
      "model/head/weight_delta_rel": 0.17513228952884674,
      "model/head/weight_norm": 58.74452590942383,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42291614413261414,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42285347855798733,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227849245071411,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905888692816873,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07834523916244507,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04171144217252731,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5345230450913242,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013468398246914148,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1564395427703857,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313072055578232,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96986198425293,
      "model/modality_embedder/grad_frac": 0.07834523916244507,
      "model/modality_embedder/grad_norm": 0.04171144217252731,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5345230450913242,
      "model/modality_embedder/update_ratio": 0.0013468398246914148,
      "model/modality_embedder/weight_delta": 3.1564395427703857,
      "model/modality_embedder/weight_delta_rel": 0.10313072055578232,
      "model/modality_embedder/weight_norm": 30.96986198425293,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.0568618774414,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.91368296055796,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.036665916442871,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.433706813922647,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05250973626971245,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02795647457242012,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000322788895573467,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009998410241678357,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7411816120147705,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0998903140425682,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960920333862305,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 92.40719604492188,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.890234187109186,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.28756332397461,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.104801959425277,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05685148015618324,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030268043279647827,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0010167170548811555,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.475477457046509,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12039325386285782,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770370483398438,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.43086242675781,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.71253707712041,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.686315536499023,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.357105566109443,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.054291196167469025,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.028904935345053673,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009402450523339212,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.765230894088745,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12642940878868103,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.74191665649414,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.04956817626953,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.450552148468816,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.460850715637207,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.551485794693527,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.04730362445116043,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.025184713304042816,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00030765816336497664,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008407432469539344,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.236497163772583,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11060811579227448,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95529556274414,
      "model/normalizer/grad_frac": 0.16660349071025848,
      "model/normalizer/grad_norm": 0.08870062232017517,
      "model/normalizer/grad_zero_frac": 0.0003001615696121007,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0011276818113401532,
      "model/normalizer/weight_delta": 6.806457996368408,
      "model/normalizer/weight_delta_rel": 0.08766324073076248,
      "model/normalizer/weight_norm": 78.6574935913086,
      "pose_mae_dtheta": 0.050149500370025635,
      "pose_mae_dx": 0.023764729499816895,
      "pose_mae_dy": 0.02121909148991108,
      "pose_rmse_dtheta": 0.14636069536209106,
      "pose_rmse_dx": 0.07622882723808289,
      "pose_rmse_dy": 0.06018945574760437,
      "pose_rmse_mean": 0.09425966441631317,
      "rmse_dtheta": 0.01942765712738037,
      "rmse_dx": 0.004192350432276726,
      "rmse_dy": 0.007144879084080458,
      "rmse_mean": 0.010254962369799614,
      "rotation_flip": 0.0061291842721402645,
      "sparse_tokens": 32073.0,
      "step": 11125,
      "turn_loss": 0.07769281417131424,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21423.0,
      "epoch": 0.516911354766772,
      "grad_norm": 0.5656788945198059,
      "learning_rate": 1.33255276811175e-07,
      "loss": 0.115,
      "mae_dtheta": 0.035106487572193146,
      "mae_dx": 0.010437878780066967,
      "mae_dy": 0.004061715677380562,
      "pose_mae_dtheta": 0.27526164054870605,
      "pose_mae_dx": 0.08691514283418655,
      "pose_mae_dy": 0.05776512250304222,
      "pose_rmse_dtheta": 0.471003919839859,
      "pose_rmse_dx": 0.20199662446975708,
      "pose_rmse_dy": 0.12318455427885056,
      "pose_rmse_mean": 0.26539504528045654,
      "rmse_dtheta": 0.0528344064950943,
      "rmse_dx": 0.02226400189101696,
      "rmse_dy": 0.007700436748564243,
      "rmse_mean": 0.02759961597621441,
      "rotation_flip": 0.008146639913320541,
      "sparse_tokens": 16652.0,
      "step": 11126,
      "turn_loss": 0.271239310503006,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5169578145326148,
      "grad_norm": 0.34649962186813354,
      "learning_rate": 1.3295222367050887e-07,
      "loss": 0.0829,
      "mae_dtheta": 0.011116091161966324,
      "mae_dx": 0.0015838432591408491,
      "mae_dy": 0.0030556267593055964,
      "pose_mae_dtheta": 0.06668496131896973,
      "pose_mae_dx": 0.02424423210322857,
      "pose_mae_dy": 0.030067812651395798,
      "pose_rmse_dtheta": 0.12246692180633545,
      "pose_rmse_dx": 0.05809766426682472,
      "pose_rmse_dy": 0.06212387979030609,
      "pose_rmse_mean": 0.08089615404605865,
      "rmse_dtheta": 0.02006073109805584,
      "rmse_dx": 0.004289379809051752,
      "rmse_dy": 0.006177383940666914,
      "rmse_mean": 0.010175831615924835,
      "rotation_flip": 0.006085842382162809,
      "sparse_tokens": 32105.0,
      "step": 11127,
      "turn_loss": 0.09418277442455292,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7145.0,
      "epoch": 0.5170042742984575,
      "grad_norm": 1.1960718631744385,
      "learning_rate": 1.3264951088510502e-07,
      "loss": 0.3409,
      "mae_dtheta": 0.03248826041817665,
      "mae_dx": 0.01498472597450018,
      "mae_dy": 0.0031440521124750376,
      "pose_mae_dtheta": 0.2715955674648285,
      "pose_mae_dx": 0.1109410971403122,
      "pose_mae_dy": 0.03650619089603424,
      "pose_rmse_dtheta": 0.45545944571495056,
      "pose_rmse_dx": 0.2594469487667084,
      "pose_rmse_dy": 0.0828721895813942,
      "pose_rmse_mean": 0.26592621207237244,
      "rmse_dtheta": 0.04850306361913681,
      "rmse_dx": 0.02890612743794918,
      "rmse_dy": 0.006503815297037363,
      "rmse_mean": 0.02797100320458412,
      "rotation_flip": 0.025787966325879097,
      "sparse_tokens": 6043.0,
      "step": 11128,
      "turn_loss": 0.21715159714221954,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5170507340643004,
      "grad_norm": 0.4445987939834595,
      "learning_rate": 1.3234713847613377e-07,
      "loss": 0.137,
      "mae_dtheta": 0.00778120057657361,
      "mae_dx": 0.003097092965617776,
      "mae_dy": 0.0022984198294579983,
      "pose_mae_dtheta": 0.048967260867357254,
      "pose_mae_dx": 0.03228597715497017,
      "pose_mae_dy": 0.03285316750407219,
      "pose_rmse_dtheta": 0.08280433714389801,
      "pose_rmse_dx": 0.10519354790449142,
      "pose_rmse_dy": 0.08050785958766937,
      "pose_rmse_mean": 0.08950191736221313,
      "rmse_dtheta": 0.014518248848617077,
      "rmse_dx": 0.011185349896550179,
      "rmse_dy": 0.004437115043401718,
      "rmse_mean": 0.010046904906630516,
      "rotation_flip": 0.004365450702607632,
      "sparse_tokens": 32105.0,
      "step": 11129,
      "turn_loss": 0.11155582219362259,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.5170971938301431,
      "grad_norm": 0.8506235480308533,
      "learning_rate": 1.3204510646474046e-07,
      "loss": 0.1345,
      "mae_dtheta": 0.04461212083697319,
      "mae_dx": 0.011200574226677418,
      "mae_dy": 0.004676894750446081,
      "pose_mae_dtheta": 0.37350207567214966,
      "pose_mae_dx": 0.08928607404232025,
      "pose_mae_dy": 0.057988084852695465,
      "pose_rmse_dtheta": 0.625779390335083,
      "pose_rmse_dx": 0.17662641406059265,
      "pose_rmse_dy": 0.14837288856506348,
      "pose_rmse_mean": 0.3169262409210205,
      "rmse_dtheta": 0.06309323012828827,
      "rmse_dx": 0.0227502528578043,
      "rmse_dy": 0.008287855423986912,
      "rmse_mean": 0.03137711435556412,
      "rotation_flip": 0.013245033100247383,
      "sparse_tokens": 7301.0,
      "step": 11130,
      "turn_loss": 0.3067745566368103,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5171436535959859,
      "grad_norm": 0.4480351209640503,
      "learning_rate": 1.3174341487204478e-07,
      "loss": 0.0908,
      "mae_dtheta": 0.007935750298202038,
      "mae_dx": 0.001394399325363338,
      "mae_dy": 0.0014393450692296028,
      "pose_mae_dtheta": 0.053739145398139954,
      "pose_mae_dx": 0.01596313714981079,
      "pose_mae_dy": 0.016459355130791664,
      "pose_rmse_dtheta": 0.1871173083782196,
      "pose_rmse_dx": 0.04472443833947182,
      "pose_rmse_dy": 0.04040822386741638,
      "pose_rmse_mean": 0.09074999392032623,
      "rmse_dtheta": 0.022096067667007446,
      "rmse_dx": 0.0045943306758999825,
      "rmse_dy": 0.0038024932146072388,
      "rmse_mean": 0.010164297185838223,
      "rotation_flip": 0.00386313465423882,
      "sparse_tokens": 32073.0,
      "step": 11131,
      "turn_loss": 0.060025423765182495,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5171901133618286,
      "grad_norm": 0.2979080379009247,
      "learning_rate": 1.3144206371914602e-07,
      "loss": 0.0691,
      "mae_dtheta": 0.009792119264602661,
      "mae_dx": 0.0015592885902151465,
      "mae_dy": 0.00043187555274926126,
      "pose_mae_dtheta": 0.0692557618021965,
      "pose_mae_dx": 0.011832278221845627,
      "pose_mae_dy": 0.005463333800435066,
      "pose_rmse_dtheta": 0.2615091800689697,
      "pose_rmse_dx": 0.02927335537970066,
      "pose_rmse_dy": 0.014560181647539139,
      "pose_rmse_mean": 0.10178091377019882,
      "rmse_dtheta": 0.03144919499754906,
      "rmse_dx": 0.004773101769387722,
      "rmse_dy": 0.0011410824954509735,
      "rmse_mean": 0.012454460375010967,
      "rotation_flip": 0.0017615972319617867,
      "sparse_tokens": 32185.0,
      "step": 11132,
      "turn_loss": 0.06284987926483154,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5172365731276715,
      "grad_norm": 0.5081267952919006,
      "learning_rate": 1.3114105302711567e-07,
      "loss": 0.1201,
      "mae_dtheta": 0.011892231181263924,
      "mae_dx": 0.0017970005283132195,
      "mae_dy": 0.0026699870359152555,
      "pose_mae_dtheta": 0.08056624978780746,
      "pose_mae_dx": 0.025273079052567482,
      "pose_mae_dy": 0.027882331982254982,
      "pose_rmse_dtheta": 0.20733892917633057,
      "pose_rmse_dx": 0.06647958606481552,
      "pose_rmse_dy": 0.06382492184638977,
      "pose_rmse_mean": 0.11254781484603882,
      "rmse_dtheta": 0.027355270460247993,
      "rmse_dx": 0.00527648301795125,
      "rmse_dy": 0.006282305810600519,
      "rmse_mean": 0.012971354648470879,
      "rotation_flip": 0.005502063315361738,
      "sparse_tokens": 32137.0,
      "step": 11133,
      "turn_loss": 0.09843261539936066,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24987.0,
      "epoch": 0.5172830328935142,
      "grad_norm": 0.5797030925750732,
      "learning_rate": 1.3084038281700572e-07,
      "loss": 0.1485,
      "mae_dtheta": 0.029252324253320694,
      "mae_dx": 0.012117433361709118,
      "mae_dy": 0.0033005475997924805,
      "pose_mae_dtheta": 0.241884246468544,
      "pose_mae_dx": 0.0878797173500061,
      "pose_mae_dy": 0.046828966587781906,
      "pose_rmse_dtheta": 0.4339110553264618,
      "pose_rmse_dx": 0.22225786745548248,
      "pose_rmse_dy": 0.13473740220069885,
      "pose_rmse_mean": 0.26363545656204224,
      "rmse_dtheta": 0.04716106504201889,
      "rmse_dx": 0.02588834799826145,
      "rmse_dy": 0.007656874135136604,
      "rmse_mean": 0.02690209448337555,
      "rotation_flip": 0.012142237275838852,
      "sparse_tokens": 20003.0,
      "step": 11134,
      "turn_loss": 0.21774733066558838,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.517329492659357,
      "grad_norm": 0.5519010424613953,
      "learning_rate": 1.3054005310984052e-07,
      "loss": 0.1776,
      "mae_dtheta": 0.00960414856672287,
      "mae_dx": 0.0016158291837200522,
      "mae_dy": 0.0026535808574408293,
      "pose_mae_dtheta": 0.06551919877529144,
      "pose_mae_dx": 0.020381221547722816,
      "pose_mae_dy": 0.02801426872611046,
      "pose_rmse_dtheta": 0.13132815062999725,
      "pose_rmse_dx": 0.05459466204047203,
      "pose_rmse_dy": 0.0647483542561531,
      "pose_rmse_mean": 0.08355706185102463,
      "rmse_dtheta": 0.01829817332327366,
      "rmse_dx": 0.004525437485426664,
      "rmse_dy": 0.005812112707644701,
      "rmse_mean": 0.009545241482555866,
      "rotation_flip": 0.00385109125636518,
      "sparse_tokens": 32121.0,
      "step": 11135,
      "turn_loss": 0.09045705199241638,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5173759524251997,
      "grad_norm": 0.5884716510772705,
      "learning_rate": 1.3024006392662326e-07,
      "loss": 0.1221,
      "mae_dtheta": 0.008047714829444885,
      "mae_dx": 0.0012702385429292917,
      "mae_dy": 0.001499461941421032,
      "pose_mae_dtheta": 0.05489620566368103,
      "pose_mae_dx": 0.01700129732489586,
      "pose_mae_dy": 0.02334284782409668,
      "pose_rmse_dtheta": 0.13279040157794952,
      "pose_rmse_dx": 0.04787403717637062,
      "pose_rmse_dy": 0.05751528590917587,
      "pose_rmse_mean": 0.07939323782920837,
      "rmse_dtheta": 0.01836567185819149,
      "rmse_dx": 0.005175672471523285,
      "rmse_dy": 0.003071343060582876,
      "rmse_mean": 0.008870895951986313,
      "rotation_flip": 0.000469924823846668,
      "sparse_tokens": 32057.0,
      "step": 11136,
      "turn_loss": 0.06380719691514969,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.5174224121910426,
      "grad_norm": 2.412020683288574,
      "learning_rate": 1.2994041528833267e-07,
      "loss": 0.2771,
      "mae_dtheta": 0.036040082573890686,
      "mae_dx": 0.009494290687143803,
      "mae_dy": 0.011905696243047714,
      "pose_mae_dtheta": 0.3030489385128021,
      "pose_mae_dx": 0.0871865525841713,
      "pose_mae_dy": 0.11700831353664398,
      "pose_rmse_dtheta": 0.5395420789718628,
      "pose_rmse_dx": 0.1614251434803009,
      "pose_rmse_dy": 0.24496161937713623,
      "pose_rmse_mean": 0.3153096139431,
      "rmse_dtheta": 0.054424434900283813,
      "rmse_dx": 0.01840832270681858,
      "rmse_dy": 0.01857099123299122,
      "rmse_mean": 0.030467916280031204,
      "rotation_flip": 0.002433090005069971,
      "sparse_tokens": 6743.0,
      "step": 11137,
      "turn_loss": 0.29192081093788147,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5174688719568853,
      "grad_norm": 0.34797587990760803,
      "learning_rate": 1.2964110721592205e-07,
      "loss": 0.0722,
      "mae_dtheta": 0.005050318315625191,
      "mae_dx": 0.0010750016663223505,
      "mae_dy": 0.0007420284091494977,
      "pose_mae_dtheta": 0.03378388285636902,
      "pose_mae_dx": 0.009862610138952732,
      "pose_mae_dy": 0.009810896590352058,
      "pose_rmse_dtheta": 0.11318151652812958,
      "pose_rmse_dx": 0.034473445266485214,
      "pose_rmse_dy": 0.029859991744160652,
      "pose_rmse_mean": 0.0591716542840004,
      "rmse_dtheta": 0.01624567247927189,
      "rmse_dx": 0.004477264359593391,
      "rmse_dy": 0.0019544048700481653,
      "rmse_mean": 0.007559114135801792,
      "rotation_flip": 0.002599090337753296,
      "sparse_tokens": 32089.0,
      "step": 11138,
      "turn_loss": 0.03496420383453369,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5175153317227281,
      "grad_norm": 0.4305516183376312,
      "learning_rate": 1.293421397303235e-07,
      "loss": 0.1068,
      "mae_dtheta": 0.006304525770246983,
      "mae_dx": 0.0011034463532269,
      "mae_dy": 0.0013866523513570428,
      "pose_mae_dtheta": 0.043009817600250244,
      "pose_mae_dx": 0.012241976335644722,
      "pose_mae_dy": 0.0158075038343668,
      "pose_rmse_dtheta": 0.13681910932064056,
      "pose_rmse_dx": 0.03601783514022827,
      "pose_rmse_dy": 0.04157200828194618,
      "pose_rmse_mean": 0.07146964967250824,
      "rmse_dtheta": 0.018578479066491127,
      "rmse_dx": 0.0037463530898094177,
      "rmse_dy": 0.0041510192677378654,
      "rmse_mean": 0.008825283497571945,
      "rotation_flip": 0.0015440040733665228,
      "sparse_tokens": 32089.0,
      "step": 11139,
      "turn_loss": 0.04666884243488312,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5175617914885708,
      "grad_norm": 0.4292331337928772,
      "learning_rate": 1.2904351285244255e-07,
      "loss": 0.1086,
      "mae_dtheta": 0.0076256911270320415,
      "mae_dx": 0.0008851798484101892,
      "mae_dy": 0.0013165007112547755,
      "pose_mae_dtheta": 0.04887532815337181,
      "pose_mae_dx": 0.012263142503798008,
      "pose_mae_dy": 0.01963805966079235,
      "pose_rmse_dtheta": 0.12676995992660522,
      "pose_rmse_dx": 0.0317445732653141,
      "pose_rmse_dy": 0.0510445162653923,
      "pose_rmse_mean": 0.06985302269458771,
      "rmse_dtheta": 0.017232567071914673,
      "rmse_dx": 0.0025958369951695204,
      "rmse_dy": 0.0027932263910770416,
      "rmse_mean": 0.0075405435636639595,
      "rotation_flip": 0.0016813786933198571,
      "sparse_tokens": 32073.0,
      "step": 11140,
      "turn_loss": 0.05440497025847435,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5176082512544137,
      "grad_norm": 0.5450708866119385,
      "learning_rate": 1.2874522660316412e-07,
      "loss": 0.0737,
      "mae_dtheta": 0.007739380933344364,
      "mae_dx": 0.001558200572617352,
      "mae_dy": 0.0017198796849697828,
      "pose_mae_dtheta": 0.052347805351018906,
      "pose_mae_dx": 0.01738777756690979,
      "pose_mae_dy": 0.01750582456588745,
      "pose_rmse_dtheta": 0.1554817259311676,
      "pose_rmse_dx": 0.041534945368766785,
      "pose_rmse_dy": 0.04697810113430023,
      "pose_rmse_mean": 0.08133159577846527,
      "rmse_dtheta": 0.02130126953125,
      "rmse_dx": 0.0042846654541790485,
      "rmse_dy": 0.005227147601544857,
      "rmse_mean": 0.010271027684211731,
      "rotation_flip": 0.00467885984107852,
      "sparse_tokens": 32169.0,
      "step": 11141,
      "turn_loss": 0.0675305426120758,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4240.0,
      "epoch": 0.5176547110202565,
      "grad_norm": 1.0040924549102783,
      "learning_rate": 1.2844728100334546e-07,
      "loss": 0.1751,
      "mae_dtheta": 0.03715033456683159,
      "mae_dx": 0.013188473880290985,
      "mae_dy": 0.004858728963881731,
      "pose_mae_dtheta": 0.31054815649986267,
      "pose_mae_dx": 0.08846188336610794,
      "pose_mae_dy": 0.03543460741639137,
      "pose_rmse_dtheta": 0.5285751819610596,
      "pose_rmse_dx": 0.1953481137752533,
      "pose_rmse_dy": 0.06905017793178558,
      "pose_rmse_mean": 0.26432451605796814,
      "rmse_dtheta": 0.05527181550860405,
      "rmse_dx": 0.024242296814918518,
      "rmse_dy": 0.00986114889383316,
      "rmse_mean": 0.029791755601763725,
      "rotation_flip": 0.00917431153357029,
      "sparse_tokens": 3461.0,
      "step": 11142,
      "turn_loss": 0.3044932186603546,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5177011707860992,
      "grad_norm": 0.3249111473560333,
      "learning_rate": 1.2814967607382433e-07,
      "loss": 0.0758,
      "mae_dtheta": 0.005155723541975021,
      "mae_dx": 0.0012625443050637841,
      "mae_dy": 0.0008157023112289608,
      "pose_mae_dtheta": 0.032420989125967026,
      "pose_mae_dx": 0.012589004822075367,
      "pose_mae_dy": 0.010936039499938488,
      "pose_rmse_dtheta": 0.09835068136453629,
      "pose_rmse_dx": 0.03225080668926239,
      "pose_rmse_dy": 0.03397762402892113,
      "pose_rmse_mean": 0.054859708994627,
      "rmse_dtheta": 0.01558761578053236,
      "rmse_dx": 0.0038005178794264793,
      "rmse_dy": 0.002002740977331996,
      "rmse_mean": 0.007130291312932968,
      "rotation_flip": 0.006260671652853489,
      "sparse_tokens": 32105.0,
      "step": 11143,
      "turn_loss": 0.0492960624396801,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2946.0,
      "epoch": 0.5177476305519421,
      "grad_norm": 0.46880042552948,
      "learning_rate": 1.278524118354102e-07,
      "loss": 0.1369,
      "mae_dtheta": 0.059495940804481506,
      "mae_dx": 0.016023334115743637,
      "mae_dy": 0.010932068340480328,
      "pose_mae_dtheta": 0.5413498282432556,
      "pose_mae_dx": 0.12981495261192322,
      "pose_mae_dy": 0.0827031284570694,
      "pose_rmse_dtheta": 0.7939196228981018,
      "pose_rmse_dx": 0.2363075613975525,
      "pose_rmse_dy": 0.15709589421749115,
      "pose_rmse_mean": 0.39577436447143555,
      "rmse_dtheta": 0.07875821739435196,
      "rmse_dx": 0.025960374623537064,
      "rmse_dy": 0.018944881856441498,
      "rmse_mean": 0.04122116044163704,
      "rotation_flip": 0.0062500000931322575,
      "sparse_tokens": 2425.0,
      "step": 11144,
      "turn_loss": 0.5376160740852356,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5177940903177848,
      "grad_norm": 0.4827638864517212,
      "learning_rate": 1.2755548830889254e-07,
      "loss": 0.101,
      "mae_dtheta": 0.011529372073709965,
      "mae_dx": 0.001757895341143012,
      "mae_dy": 0.002304635476320982,
      "pose_mae_dtheta": 0.08309107273817062,
      "pose_mae_dx": 0.022426903247833252,
      "pose_mae_dy": 0.027355581521987915,
      "pose_rmse_dtheta": 0.19431918859481812,
      "pose_rmse_dx": 0.05644781142473221,
      "pose_rmse_dy": 0.06022775545716286,
      "pose_rmse_mean": 0.10366491973400116,
      "rmse_dtheta": 0.02454511635005474,
      "rmse_dx": 0.00534847192466259,
      "rmse_dy": 0.0051624164916574955,
      "rmse_mean": 0.011685336008667946,
      "rotation_flip": 0.0038669761270284653,
      "sparse_tokens": 32089.0,
      "step": 11145,
      "turn_loss": 0.0776878297328949,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.5178405500836276,
      "grad_norm": 0.7716454863548279,
      "learning_rate": 1.2725890551503472e-07,
      "loss": 0.1723,
      "mae_dtheta": 0.03172622621059418,
      "mae_dx": 0.005550877191126347,
      "mae_dy": 0.002399878343567252,
      "pose_mae_dtheta": 0.2560740113258362,
      "pose_mae_dx": 0.042211491614580154,
      "pose_mae_dy": 0.029749887064099312,
      "pose_rmse_dtheta": 0.5435999631881714,
      "pose_rmse_dx": 0.09831470251083374,
      "pose_rmse_dy": 0.0753122866153717,
      "pose_rmse_mean": 0.2390756607055664,
      "rmse_dtheta": 0.05586976557970047,
      "rmse_dx": 0.013626998290419579,
      "rmse_dy": 0.005519982893019915,
      "rmse_mean": 0.025005584582686424,
      "rotation_flip": 0.002998500829562545,
      "sparse_tokens": 10821.0,
      "step": 11146,
      "turn_loss": 0.2342308759689331,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5178870098494703,
      "grad_norm": 0.5491464138031006,
      "learning_rate": 1.2696266347457686e-07,
      "loss": 0.1129,
      "mae_dtheta": 0.011433513835072517,
      "mae_dx": 0.0030391220934689045,
      "mae_dy": 0.002136624651029706,
      "pose_mae_dtheta": 0.06685894727706909,
      "pose_mae_dx": 0.030603455379605293,
      "pose_mae_dy": 0.028654707595705986,
      "pose_rmse_dtheta": 0.16957242786884308,
      "pose_rmse_dx": 0.08666966110467911,
      "pose_rmse_dy": 0.06869276612997055,
      "pose_rmse_mean": 0.10831162333488464,
      "rmse_dtheta": 0.02464425563812256,
      "rmse_dx": 0.009949369356036186,
      "rmse_dy": 0.004379181656986475,
      "rmse_mean": 0.012990936636924744,
      "rotation_flip": 0.00913241971284151,
      "sparse_tokens": 32089.0,
      "step": 11147,
      "turn_loss": 0.12613314390182495,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.5179334696153132,
      "grad_norm": 0.4621870815753937,
      "learning_rate": 1.266667622082357e-07,
      "loss": 0.0951,
      "mae_dtheta": 0.032194122672080994,
      "mae_dx": 0.006106218323111534,
      "mae_dy": 0.007595884148031473,
      "pose_mae_dtheta": 0.23532508313655853,
      "pose_mae_dx": 0.04801559820771217,
      "pose_mae_dy": 0.06935229152441025,
      "pose_rmse_dtheta": 0.45183053612709045,
      "pose_rmse_dx": 0.11916925013065338,
      "pose_rmse_dy": 0.1873854696750641,
      "pose_rmse_mean": 0.25279510021209717,
      "rmse_dtheta": 0.05109768360853195,
      "rmse_dx": 0.014424053020775318,
      "rmse_dy": 0.018321098759770393,
      "rmse_mean": 0.02794761210680008,
      "rotation_flip": 0.01244813296943903,
      "sparse_tokens": 4447.0,
      "step": 11148,
      "turn_loss": 0.34788352251052856,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5179799293811559,
      "grad_norm": 0.4299938678741455,
      "learning_rate": 1.263712017367036e-07,
      "loss": 0.0785,
      "mae_dtheta": 0.009847575798630714,
      "mae_dx": 0.0013568788999691606,
      "mae_dy": 0.002133068395778537,
      "pose_mae_dtheta": 0.05967447906732559,
      "pose_mae_dx": 0.019081799313426018,
      "pose_mae_dy": 0.024134330451488495,
      "pose_rmse_dtheta": 0.14956626296043396,
      "pose_rmse_dx": 0.05070052295923233,
      "pose_rmse_dy": 0.060438260436058044,
      "pose_rmse_mean": 0.08690168708562851,
      "rmse_dtheta": 0.02178794890642166,
      "rmse_dx": 0.004008297808468342,
      "rmse_dy": 0.004894920624792576,
      "rmse_mean": 0.01023038849234581,
      "rotation_flip": 0.0034737298265099525,
      "sparse_tokens": 32057.0,
      "step": 11149,
      "turn_loss": 0.07591746747493744,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5180263891469987,
      "grad_norm": 0.3144061863422394,
      "learning_rate": 1.2607598208064843e-07,
      "loss": 0.0609,
      "mae_dtheta": 0.008904436603188515,
      "mae_dx": 0.0011044072452932596,
      "mae_dy": 0.0005728991818614304,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3144061863422394,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.3355255126953,
      "model/head/act_norm_mean": 131.69927793560606,
      "model/head/act_norm_min": 68.57044982910156,
      "model/head/act_over_embed": 90.50497678541457,
      "model/head/grad_frac": 0.0910806655883789,
      "model/head/grad_norm": 0.028636325150728226,
      "model/head/grad_zero_frac": 0.00021986934007145464,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6990165325126263,
      "model/head/update_ratio": 0.0004874718433711678,
      "model/head/weight_delta": 9.983292579650879,
      "model/head/weight_delta_rel": 0.1751365214586258,
      "model/head/weight_norm": 58.744571685791016,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229568541049957,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228579258814649,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227951467037201,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059192552401764,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09720605611801147,
      "model/modality_embedder.encoders.pose/grad_norm": 0.030562184751033783,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5287936681222707,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009868358029052615,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156571626663208,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313503444194794,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969879150390625,
      "model/modality_embedder/grad_frac": 0.09720605611801147,
      "model/modality_embedder/grad_norm": 0.030562184751033783,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5287936681222707,
      "model/modality_embedder/update_ratio": 0.0009868358029052615,
      "model/modality_embedder/weight_delta": 3.156571626663208,
      "model/modality_embedder/weight_delta_rel": 0.10313503444194794,
      "model/modality_embedder/weight_norm": 30.969879150390625,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.6718521118164,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.761213323713324,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.039311408996582,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.70334697633479,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05630260333418846,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.0177018865942955,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0006330930045805871,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.741328001022339,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0998956486582756,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960956573486328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.83492279052734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.771629990379992,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.310188293457031,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 18.397714769338,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05475356802344322,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.017214860767126083,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002975710085593164,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0005782541120424867,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4756553173065186,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12039941549301147,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77040672302246,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.46961212158203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 28.578448172198172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.212505340576172,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.63937713958178,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05350913852453232,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.016823604702949524,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000547251955140382,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7654294967651367,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12643606960773468,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.741971969604492,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.1605453491211,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 30.2033655002405,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.106376647949219,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.756035540128174,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.049194082617759705,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.015466923825442791,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0005163332098163664,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.236644983291626,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11061316728591919,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95531463623047,
      "model/normalizer/grad_frac": 0.1946590393781662,
      "model/normalizer/grad_norm": 0.06120200455188751,
      "model/normalizer/grad_zero_frac": 0.00027298156055621803,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0007780817686580122,
      "model/normalizer/weight_delta": 6.806805610656738,
      "model/normalizer/weight_delta_rel": 0.08766771852970123,
      "model/normalizer/weight_norm": 78.65754699707031,
      "pose_mae_dtheta": 0.06059922277927399,
      "pose_mae_dx": 0.009062436409294605,
      "pose_mae_dy": 0.0068390462547540665,
      "pose_rmse_dtheta": 0.26151713728904724,
      "pose_rmse_dx": 0.022193599492311478,
      "pose_rmse_dy": 0.022639349102973938,
      "pose_rmse_mean": 0.10211670398712158,
      "rmse_dtheta": 0.031558435410261154,
      "rmse_dx": 0.003328281454741955,
      "rmse_dy": 0.002490145154297352,
      "rmse_mean": 0.012458954006433487,
      "rotation_flip": 0.003389830468222499,
      "sparse_tokens": 32153.0,
      "step": 11150,
      "turn_loss": 0.049023959785699844,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37846.0,
      "epoch": 0.5180728489128414,
      "grad_norm": 0.6427330374717712,
      "learning_rate": 1.2578110326071702e-07,
      "loss": 0.1874,
      "mae_dtheta": 0.04195276275277138,
      "mae_dx": 0.01346212811768055,
      "mae_dy": 0.006994760129600763,
      "pose_mae_dtheta": 0.37005338072776794,
      "pose_mae_dx": 0.11108370125293732,
      "pose_mae_dy": 0.07615595310926437,
      "pose_rmse_dtheta": 0.6055104732513428,
      "pose_rmse_dx": 0.23876719176769257,
      "pose_rmse_dy": 0.18526645004749298,
      "pose_rmse_mean": 0.3431813716888428,
      "rmse_dtheta": 0.06009327247738838,
      "rmse_dx": 0.02538904920220375,
      "rmse_dy": 0.015827173367142677,
      "rmse_mean": 0.03376983106136322,
      "rotation_flip": 0.012061403132975101,
      "sparse_tokens": 29449.0,
      "step": 11151,
      "turn_loss": 0.3761735260486603,
      "turns": 117.0,
      "turns_per_sample": 117.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.5181193086786843,
      "grad_norm": 0.5820416808128357,
      "learning_rate": 1.2548656529752845e-07,
      "loss": 0.1302,
      "mae_dtheta": 0.03843521699309349,
      "mae_dx": 0.008350666612386703,
      "mae_dy": 0.004860172979533672,
      "pose_mae_dtheta": 0.29121118783950806,
      "pose_mae_dx": 0.06284560263156891,
      "pose_mae_dy": 0.07580845803022385,
      "pose_rmse_dtheta": 0.5082615613937378,
      "pose_rmse_dx": 0.14949648082256317,
      "pose_rmse_dy": 0.16857552528381348,
      "pose_rmse_mean": 0.27544453740119934,
      "rmse_dtheta": 0.05834485590457916,
      "rmse_dx": 0.019467180594801903,
      "rmse_dy": 0.00920442771166563,
      "rmse_mean": 0.029005488380789757,
      "rotation_flip": 0.017902813851833344,
      "sparse_tokens": 7357.0,
      "step": 11152,
      "turn_loss": 0.21753427386283875,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.518165768444527,
      "grad_norm": 0.6033719778060913,
      "learning_rate": 1.251923682116807e-07,
      "loss": 0.1544,
      "mae_dtheta": 0.044187918305397034,
      "mae_dx": 0.006852494552731514,
      "mae_dy": 0.00285353627987206,
      "pose_mae_dtheta": 0.38158321380615234,
      "pose_mae_dx": 0.04428889602422714,
      "pose_mae_dy": 0.0279193464666605,
      "pose_rmse_dtheta": 0.7251341938972473,
      "pose_rmse_dx": 0.09659382700920105,
      "pose_rmse_dy": 0.06510616093873978,
      "pose_rmse_mean": 0.2956113815307617,
      "rmse_dtheta": 0.07077817618846893,
      "rmse_dx": 0.016965683549642563,
      "rmse_dy": 0.005605837795883417,
      "rmse_mean": 0.03111656755208969,
      "rotation_flip": 0.013274336233735085,
      "sparse_tokens": 3984.0,
      "step": 11153,
      "turn_loss": 0.2031586617231369,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5182122282103698,
      "grad_norm": 0.5880999565124512,
      "learning_rate": 1.2489851202374725e-07,
      "loss": 0.1073,
      "mae_dtheta": 0.007674787659198046,
      "mae_dx": 0.0016867037629708648,
      "mae_dy": 0.0012595317093655467,
      "pose_mae_dtheta": 0.05591195821762085,
      "pose_mae_dx": 0.018378417938947678,
      "pose_mae_dy": 0.014853711239993572,
      "pose_rmse_dtheta": 0.22087901830673218,
      "pose_rmse_dx": 0.04799787327647209,
      "pose_rmse_dy": 0.04065860062837601,
      "pose_rmse_mean": 0.1031784936785698,
      "rmse_dtheta": 0.024805158376693726,
      "rmse_dx": 0.005235438700765371,
      "rmse_dy": 0.0033234190195798874,
      "rmse_mean": 0.011121339164674282,
      "rotation_flip": 0.0021367522422224283,
      "sparse_tokens": 32121.0,
      "step": 11154,
      "turn_loss": 0.0627947449684143,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5182586879762126,
      "grad_norm": 0.37980467081069946,
      "learning_rate": 1.246049967542773e-07,
      "loss": 0.1003,
      "mae_dtheta": 0.012334998697042465,
      "mae_dx": 0.002773273503407836,
      "mae_dy": 0.0026254162658005953,
      "pose_mae_dtheta": 0.08167985826730728,
      "pose_mae_dx": 0.026067987084388733,
      "pose_mae_dy": 0.02553934045135975,
      "pose_rmse_dtheta": 0.19454888999462128,
      "pose_rmse_dx": 0.06884076446294785,
      "pose_rmse_dy": 0.054268185049295425,
      "pose_rmse_mean": 0.10588594526052475,
      "rmse_dtheta": 0.02664838917553425,
      "rmse_dx": 0.00841051246970892,
      "rmse_dy": 0.006653157062828541,
      "rmse_mean": 0.013904019258916378,
      "rotation_flip": 0.004305704962462187,
      "sparse_tokens": 32153.0,
      "step": 11155,
      "turn_loss": 0.09825591742992401,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.5183051477420554,
      "grad_norm": 0.6525940895080566,
      "learning_rate": 1.2431182242379713e-07,
      "loss": 0.0802,
      "mae_dtheta": 0.018716873601078987,
      "mae_dx": 0.0024940462317317724,
      "mae_dy": 0.0012769338209182024,
      "pose_mae_dtheta": 0.15209722518920898,
      "pose_mae_dx": 0.01718784123659134,
      "pose_mae_dy": 0.014600098133087158,
      "pose_rmse_dtheta": 0.4324313998222351,
      "pose_rmse_dx": 0.052044011652469635,
      "pose_rmse_dy": 0.0464860163629055,
      "pose_rmse_mean": 0.17698714137077332,
      "rmse_dtheta": 0.04412294551730156,
      "rmse_dx": 0.007043391466140747,
      "rmse_dy": 0.0037389888893812895,
      "rmse_mean": 0.01830177567899227,
      "rotation_flip": 0.003610108280554414,
      "sparse_tokens": 11144.0,
      "step": 11156,
      "turn_loss": 0.10014590620994568,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5183516075078982,
      "grad_norm": 0.4317069947719574,
      "learning_rate": 1.2401898905280761e-07,
      "loss": 0.1283,
      "mae_dtheta": 0.007552304305136204,
      "mae_dx": 0.0015551685355603695,
      "mae_dy": 0.0026427232660353184,
      "pose_mae_dtheta": 0.049144942313432693,
      "pose_mae_dx": 0.02345224656164646,
      "pose_mae_dy": 0.02493228018283844,
      "pose_rmse_dtheta": 0.1015859916806221,
      "pose_rmse_dx": 0.07016477733850479,
      "pose_rmse_dy": 0.060138262808322906,
      "pose_rmse_mean": 0.07729634642601013,
      "rmse_dtheta": 0.01563139632344246,
      "rmse_dx": 0.004216740373522043,
      "rmse_dy": 0.006131644826382399,
      "rmse_mean": 0.008659927174448967,
      "rotation_flip": 0.006432246882468462,
      "sparse_tokens": 32073.0,
      "step": 11157,
      "turn_loss": 0.07978686690330505,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.5183980672737409,
      "grad_norm": 0.4656777083873749,
      "learning_rate": 1.2372649666178793e-07,
      "loss": 0.1126,
      "mae_dtheta": 0.031730521470308304,
      "mae_dx": 0.009525575675070286,
      "mae_dy": 0.004226037301123142,
      "pose_mae_dtheta": 0.23321011662483215,
      "pose_mae_dx": 0.07747485488653183,
      "pose_mae_dy": 0.05458590015769005,
      "pose_rmse_dtheta": 0.4641459882259369,
      "pose_rmse_dx": 0.19129984080791473,
      "pose_rmse_dy": 0.10402413457632065,
      "pose_rmse_mean": 0.2531566619873047,
      "rmse_dtheta": 0.050228655338287354,
      "rmse_dx": 0.022480571642518044,
      "rmse_dy": 0.0074235824868083,
      "rmse_mean": 0.026710934937000275,
      "rotation_flip": 0.00805152952671051,
      "sparse_tokens": 11049.0,
      "step": 11158,
      "turn_loss": 0.19084957242012024,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.5184445270395838,
      "grad_norm": 1.0593327283859253,
      "learning_rate": 1.2343434527119112e-07,
      "loss": 0.3031,
      "mae_dtheta": 0.021088754758238792,
      "mae_dx": 0.009216820821166039,
      "mae_dy": 0.00901285745203495,
      "pose_mae_dtheta": 0.1476498544216156,
      "pose_mae_dx": 0.08526185154914856,
      "pose_mae_dy": 0.11763665825128555,
      "pose_rmse_dtheta": 0.2515331506729126,
      "pose_rmse_dx": 0.18239368498325348,
      "pose_rmse_dy": 0.21065430343151093,
      "pose_rmse_mean": 0.21486037969589233,
      "rmse_dtheta": 0.030511870980262756,
      "rmse_dx": 0.022053351625800133,
      "rmse_dy": 0.015877339988946915,
      "rmse_mean": 0.0228141900151968,
      "rotation_flip": 0.007905138656497002,
      "sparse_tokens": 5514.0,
      "step": 11159,
      "turn_loss": 0.3542754054069519,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5184909868054265,
      "grad_norm": 0.4081336259841919,
      "learning_rate": 1.2314253490144757e-07,
      "loss": 0.0811,
      "mae_dtheta": 0.008789733052253723,
      "mae_dx": 0.0014187784399837255,
      "mae_dy": 0.001594272325746715,
      "pose_mae_dtheta": 0.06008153781294823,
      "pose_mae_dx": 0.016666732728481293,
      "pose_mae_dy": 0.021708324551582336,
      "pose_rmse_dtheta": 0.16842496395111084,
      "pose_rmse_dx": 0.048295196145772934,
      "pose_rmse_dy": 0.052191123366355896,
      "pose_rmse_mean": 0.08963710069656372,
      "rmse_dtheta": 0.02158438414335251,
      "rmse_dx": 0.0050492784939706326,
      "rmse_dy": 0.004025845788419247,
      "rmse_mean": 0.010219836607575417,
      "rotation_flip": 0.0009510223753750324,
      "sparse_tokens": 32089.0,
      "step": 11160,
      "turn_loss": 0.07132578641176224,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.5185374465712693,
      "grad_norm": 0.7044717669487,
      "learning_rate": 1.2285106557296479e-07,
      "loss": 0.196,
      "mae_dtheta": 0.015111176297068596,
      "mae_dx": 0.010901599191129208,
      "mae_dy": 0.0011432457249611616,
      "pose_mae_dtheta": 0.11005887389183044,
      "pose_mae_dx": 0.09749635308980942,
      "pose_mae_dy": 0.02608063630759716,
      "pose_rmse_dtheta": 0.27887701988220215,
      "pose_rmse_dx": 0.2955322563648224,
      "pose_rmse_dy": 0.07322512567043304,
      "pose_rmse_mean": 0.21587812900543213,
      "rmse_dtheta": 0.034982357174158096,
      "rmse_dx": 0.027360551059246063,
      "rmse_dy": 0.0027244898956269026,
      "rmse_mean": 0.02168913185596466,
      "rotation_flip": 0.00800000037997961,
      "sparse_tokens": 6514.0,
      "step": 11161,
      "turn_loss": 0.08777384459972382,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 16563.0,
      "epoch": 0.518583906337112,
      "grad_norm": 0.8124147653579712,
      "learning_rate": 1.2255993730612482e-07,
      "loss": 0.158,
      "mae_dtheta": 0.03410245105624199,
      "mae_dx": 0.011370626278221607,
      "mae_dy": 0.004947185050696135,
      "pose_mae_dtheta": 0.2664535641670227,
      "pose_mae_dx": 0.0804198682308197,
      "pose_mae_dy": 0.03466804325580597,
      "pose_rmse_dtheta": 0.49237915873527527,
      "pose_rmse_dx": 0.18207839131355286,
      "pose_rmse_dy": 0.08569411933422089,
      "pose_rmse_mean": 0.25338390469551086,
      "rmse_dtheta": 0.05437217280268669,
      "rmse_dx": 0.023128565400838852,
      "rmse_dy": 0.012131711468100548,
      "rmse_mean": 0.02987748384475708,
      "rotation_flip": 0.011834319680929184,
      "sparse_tokens": 13648.0,
      "step": 11162,
      "turn_loss": 0.2467327117919922,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5186303661029549,
      "grad_norm": 0.37871870398521423,
      "learning_rate": 1.2226915012128637e-07,
      "loss": 0.0688,
      "mae_dtheta": 0.006336282938718796,
      "mae_dx": 0.0011327023385092616,
      "mae_dy": 0.001385544310323894,
      "pose_mae_dtheta": 0.04736219346523285,
      "pose_mae_dx": 0.012124678120017052,
      "pose_mae_dy": 0.015069202519953251,
      "pose_rmse_dtheta": 0.19323305785655975,
      "pose_rmse_dx": 0.04562695324420929,
      "pose_rmse_dy": 0.05499139800667763,
      "pose_rmse_mean": 0.09795047342777252,
      "rmse_dtheta": 0.019869977608323097,
      "rmse_dx": 0.0043871537782251835,
      "rmse_dy": 0.004337097052484751,
      "rmse_mean": 0.009531409479677677,
      "rotation_flip": 0.005829015746712685,
      "sparse_tokens": 32057.0,
      "step": 11163,
      "turn_loss": 0.04121866449713707,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16563.0,
      "epoch": 0.5186768258687976,
      "grad_norm": 0.4399223327636719,
      "learning_rate": 1.2197870403878375e-07,
      "loss": 0.1078,
      "mae_dtheta": 0.02161741629242897,
      "mae_dx": 0.004613172262907028,
      "mae_dy": 0.0031903008930385113,
      "pose_mae_dtheta": 0.1639387458562851,
      "pose_mae_dx": 0.03729451820254326,
      "pose_mae_dy": 0.04142729938030243,
      "pose_rmse_dtheta": 0.31876808404922485,
      "pose_rmse_dx": 0.09921514242887497,
      "pose_rmse_dy": 0.09638845175504684,
      "pose_rmse_mean": 0.1714572310447693,
      "rmse_dtheta": 0.03638484328985214,
      "rmse_dx": 0.012835814617574215,
      "rmse_dy": 0.006316084414720535,
      "rmse_mean": 0.018512248992919922,
      "rotation_flip": 0.0030303029343485832,
      "sparse_tokens": 14056.0,
      "step": 11164,
      "turn_loss": 0.16514968872070312,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 33088.0,
      "epoch": 0.5187232856346404,
      "grad_norm": 0.6954048871994019,
      "learning_rate": 1.2168859907892904e-07,
      "loss": 0.1634,
      "mae_dtheta": 0.030388569459319115,
      "mae_dx": 0.010352504439651966,
      "mae_dy": 0.00556586217135191,
      "pose_mae_dtheta": 0.22630171477794647,
      "pose_mae_dx": 0.08772660791873932,
      "pose_mae_dy": 0.06780445575714111,
      "pose_rmse_dtheta": 0.4037272334098816,
      "pose_rmse_dx": 0.2083292007446289,
      "pose_rmse_dy": 0.15252310037612915,
      "pose_rmse_mean": 0.2548598647117615,
      "rmse_dtheta": 0.047706905752420425,
      "rmse_dx": 0.022427881136536598,
      "rmse_dy": 0.010589311830699444,
      "rmse_mean": 0.026908032596111298,
      "rotation_flip": 0.01077199261635542,
      "sparse_tokens": 25291.0,
      "step": 11165,
      "turn_loss": 0.2551834285259247,
      "turns": 102.0,
      "turns_per_sample": 102.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5187697454004832,
      "grad_norm": 0.7924562692642212,
      "learning_rate": 1.2139883526200825e-07,
      "loss": 0.1749,
      "mae_dtheta": 0.008539753034710884,
      "mae_dx": 0.0018564945785328746,
      "mae_dy": 0.002651937073096633,
      "pose_mae_dtheta": 0.05851835757493973,
      "pose_mae_dx": 0.024904878810048103,
      "pose_mae_dy": 0.023376833647489548,
      "pose_rmse_dtheta": 0.16186591982841492,
      "pose_rmse_dx": 0.06832680106163025,
      "pose_rmse_dy": 0.05019987002015114,
      "pose_rmse_mean": 0.093464195728302,
      "rmse_dtheta": 0.019953498616814613,
      "rmse_dx": 0.005445307120680809,
      "rmse_dy": 0.005621009971946478,
      "rmse_mean": 0.010339939035475254,
      "rotation_flip": 0.005179282743483782,
      "sparse_tokens": 32057.0,
      "step": 11166,
      "turn_loss": 0.07641303539276123,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.518816205166326,
      "grad_norm": 0.39744722843170166,
      "learning_rate": 1.211094126082857e-07,
      "loss": 0.0954,
      "mae_dtheta": 0.011314252391457558,
      "mae_dx": 0.002261210698634386,
      "mae_dy": 0.0031185054685920477,
      "pose_mae_dtheta": 0.06970001012086868,
      "pose_mae_dx": 0.028461752459406853,
      "pose_mae_dy": 0.034013450145721436,
      "pose_rmse_dtheta": 0.1446240246295929,
      "pose_rmse_dx": 0.07955952733755112,
      "pose_rmse_dy": 0.08941298723220825,
      "pose_rmse_mean": 0.10453218221664429,
      "rmse_dtheta": 0.022949062287807465,
      "rmse_dx": 0.00677994079887867,
      "rmse_dy": 0.007642908953130245,
      "rmse_mean": 0.012457303702831268,
      "rotation_flip": 0.013366162776947021,
      "sparse_tokens": 32137.0,
      "step": 11167,
      "turn_loss": 0.1150318905711174,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5188626649321687,
      "grad_norm": 0.6283372044563293,
      "learning_rate": 1.2082033113800128e-07,
      "loss": 0.0959,
      "mae_dtheta": 0.018795691430568695,
      "mae_dx": 0.0027685847599059343,
      "mae_dy": 0.004553563892841339,
      "pose_mae_dtheta": 0.14579203724861145,
      "pose_mae_dx": 0.03896322473883629,
      "pose_mae_dy": 0.05795940011739731,
      "pose_rmse_dtheta": 0.34289073944091797,
      "pose_rmse_dx": 0.1012708991765976,
      "pose_rmse_dy": 0.15487375855445862,
      "pose_rmse_mean": 0.1996784657239914,
      "rmse_dtheta": 0.037854403257369995,
      "rmse_dx": 0.00732450233772397,
      "rmse_dy": 0.010087390430271626,
      "rmse_mean": 0.018422098830342293,
      "rotation_flip": 0.008497620932757854,
      "sparse_tokens": 32137.0,
      "step": 11168,
      "turn_loss": 0.1500537246465683,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.5189091246980115,
      "grad_norm": 0.8290244340896606,
      "learning_rate": 1.205315908713689e-07,
      "loss": 0.1382,
      "mae_dtheta": 0.022509362548589706,
      "mae_dx": 0.006815546192228794,
      "mae_dy": 0.0039862701669335365,
      "pose_mae_dtheta": 0.1705513298511505,
      "pose_mae_dx": 0.05540464073419571,
      "pose_mae_dy": 0.03398604691028595,
      "pose_rmse_dtheta": 0.3027641773223877,
      "pose_rmse_dx": 0.11970836669206619,
      "pose_rmse_dy": 0.06965848058462143,
      "pose_rmse_mean": 0.16404367983341217,
      "rmse_dtheta": 0.03677678108215332,
      "rmse_dx": 0.01473380159586668,
      "rmse_dy": 0.007320805918425322,
      "rmse_mean": 0.019610464572906494,
      "rotation_flip": 0.01326699834316969,
      "sparse_tokens": 10388.0,
      "step": 11169,
      "turn_loss": 0.17714273929595947,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5189555844638543,
      "grad_norm": 0.33378466963768005,
      "learning_rate": 1.2024319182858235e-07,
      "loss": 0.0711,
      "mae_dtheta": 0.006831716280430555,
      "mae_dx": 0.001844939892180264,
      "mae_dy": 0.0014637565473094583,
      "pose_mae_dtheta": 0.04997056722640991,
      "pose_mae_dx": 0.01996082253754139,
      "pose_mae_dy": 0.015831677243113518,
      "pose_rmse_dtheta": 0.17505663633346558,
      "pose_rmse_dx": 0.07351595163345337,
      "pose_rmse_dy": 0.04467732831835747,
      "pose_rmse_mean": 0.0977499708533287,
      "rmse_dtheta": 0.02088780514895916,
      "rmse_dx": 0.006311115343123674,
      "rmse_dy": 0.004818788263946772,
      "rmse_mean": 0.010672569274902344,
      "rotation_flip": 0.005837711505591869,
      "sparse_tokens": 32089.0,
      "step": 11170,
      "turn_loss": 0.053623780608177185,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5190020442296971,
      "grad_norm": 0.3613145053386688,
      "learning_rate": 1.1995513402980775e-07,
      "loss": 0.0929,
      "mae_dtheta": 0.013246141374111176,
      "mae_dx": 0.0016864003846421838,
      "mae_dy": 0.0021626208908855915,
      "pose_mae_dtheta": 0.09163018316030502,
      "pose_mae_dx": 0.02034050039947033,
      "pose_mae_dy": 0.024918047711253166,
      "pose_rmse_dtheta": 0.2716507911682129,
      "pose_rmse_dx": 0.04976984113454819,
      "pose_rmse_dy": 0.06154010817408562,
      "pose_rmse_mean": 0.1276535838842392,
      "rmse_dtheta": 0.03248368576169014,
      "rmse_dx": 0.004755283705890179,
      "rmse_dy": 0.005028220359236002,
      "rmse_mean": 0.014089064672589302,
      "rotation_flip": 0.0041649313643574715,
      "sparse_tokens": 32121.0,
      "step": 11171,
      "turn_loss": 0.10319401323795319,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.5190485039955398,
      "grad_norm": 0.5417957901954651,
      "learning_rate": 1.1966741749519061e-07,
      "loss": 0.1347,
      "mae_dtheta": 0.030508479103446007,
      "mae_dx": 0.008613009005784988,
      "mae_dy": 0.004665634594857693,
      "pose_mae_dtheta": 0.2591519355773926,
      "pose_mae_dx": 0.07129126787185669,
      "pose_mae_dy": 0.050066858530044556,
      "pose_rmse_dtheta": 0.4693327844142914,
      "pose_rmse_dx": 0.1807808130979538,
      "pose_rmse_dy": 0.1183628961443901,
      "pose_rmse_mean": 0.25615882873535156,
      "rmse_dtheta": 0.05074658244848251,
      "rmse_dx": 0.01943892426788807,
      "rmse_dy": 0.01169847697019577,
      "rmse_mean": 0.027294661849737167,
      "rotation_flip": 0.020172910764813423,
      "sparse_tokens": 11995.0,
      "step": 11172,
      "turn_loss": 0.2145109921693802,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 19095.0,
      "epoch": 0.5190949637613826,
      "grad_norm": 0.5681802034378052,
      "learning_rate": 1.193800422448499e-07,
      "loss": 0.1505,
      "mae_dtheta": 0.030122213065624237,
      "mae_dx": 0.009741272777318954,
      "mae_dy": 0.0028674989007413387,
      "pose_mae_dtheta": 0.2512773871421814,
      "pose_mae_dx": 0.07254353165626526,
      "pose_mae_dy": 0.0437190867960453,
      "pose_rmse_dtheta": 0.5139269232749939,
      "pose_rmse_dx": 0.21115729212760925,
      "pose_rmse_dy": 0.1146453395485878,
      "pose_rmse_mean": 0.2799098491668701,
      "rmse_dtheta": 0.05116795003414154,
      "rmse_dx": 0.023348262533545494,
      "rmse_dy": 0.006757003720849752,
      "rmse_mean": 0.027091074734926224,
      "rotation_flip": 0.007776049897074699,
      "sparse_tokens": 15712.0,
      "step": 11173,
      "turn_loss": 0.18574869632720947,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.5191414235272255,
      "grad_norm": 0.48719435930252075,
      "learning_rate": 1.1909300829888227e-07,
      "loss": 0.1346,
      "mae_dtheta": 0.03183610364794731,
      "mae_dx": 0.01236712746322155,
      "mae_dy": 0.004974702838808298,
      "pose_mae_dtheta": 0.24720679223537445,
      "pose_mae_dx": 0.10308390110731125,
      "pose_mae_dy": 0.057537566870450974,
      "pose_rmse_dtheta": 0.45997530221939087,
      "pose_rmse_dx": 0.21530446410179138,
      "pose_rmse_dy": 0.13528048992156982,
      "pose_rmse_mean": 0.27018675208091736,
      "rmse_dtheta": 0.049544867128133774,
      "rmse_dx": 0.02470034919679165,
      "rmse_dy": 0.009799371473491192,
      "rmse_mean": 0.028014861047267914,
      "rotation_flip": 0.017126545310020447,
      "sparse_tokens": 19196.0,
      "step": 11174,
      "turn_loss": 0.26669397950172424,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5191878832930682,
      "grad_norm": 0.627172589302063,
      "learning_rate": 1.1880631567736056e-07,
      "loss": 0.1446,
      "mae_dtheta": 0.00749953743070364,
      "mae_dx": 0.001332132495008409,
      "mae_dy": 0.0011541948188096285,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6271725296974182,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 153.87884521484375,
      "model/head/act_norm_mean": 115.98574613320707,
      "model/head/act_norm_min": 61.73283767700195,
      "model/head/act_over_embed": 79.70649061840345,
      "model/head/grad_frac": 0.10839097201824188,
      "model/head/grad_norm": 0.0679798424243927,
      "model/head/grad_zero_frac": 0.00018021036521531641,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7074356849747475,
      "model/head/update_ratio": 0.0011572096263989806,
      "model/head/weight_delta": 9.98351764678955,
      "model/head/weight_delta_rel": 0.17514047026634216,
      "model/head/weight_norm": 58.74462127685547,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42293137311935425,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42286788187753993,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42280006408691406,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905987673777299,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07026602327823639,
      "model/modality_embedder.encoders.pose/grad_norm": 0.044068921357393265,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5478121496636771,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014229608932510018,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156620502471924,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313662886619568,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96987533569336,
      "model/modality_embedder/grad_frac": 0.07026602327823639,
      "model/modality_embedder/grad_norm": 0.044068921357393265,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5478121496636771,
      "model/modality_embedder/update_ratio": 0.0014229608932510018,
      "model/modality_embedder/weight_delta": 3.156620502471924,
      "model/modality_embedder/weight_delta_rel": 0.10313662886619568,
      "model/modality_embedder/weight_norm": 30.96987533569336,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.51750183105469,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.135917708834377,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.019237518310547,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.586428613532696,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06060916185379028,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03801240026950836,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013594813644886017,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.741468667984009,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09990077465772629,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.960956573486328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.26578521728516,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.104650172358507,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.28101634979248,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.252150631882692,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05974150076508522,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03746822848916054,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012585713993757963,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4758167266845703,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12040501087903976,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770442962646484,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.09720611572266,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.89085046897547,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.280646324157715,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.479644198388513,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06111231446266174,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03832796588540077,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012467610649764538,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7656240463256836,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12644261121749878,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742029190063477,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 93.8052978515625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.55006162818663,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.197579383850098,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.619869640778035,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05389980971813202,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.033804479986429214,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011284960201010108,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2368178367614746,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11061907559633255,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955339431762695,
      "model/normalizer/grad_frac": 0.19177868962287903,
      "model/normalizer/grad_norm": 0.12027832865715027,
      "model/normalizer/grad_zero_frac": 0.000252892030403018,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0015291385352611542,
      "model/normalizer/weight_delta": 6.807144641876221,
      "model/normalizer/weight_delta_rel": 0.08767208456993103,
      "model/normalizer/weight_norm": 78.65757751464844,
      "pose_mae_dtheta": 0.05350211635231972,
      "pose_mae_dx": 0.012342373840510845,
      "pose_mae_dy": 0.017164133489131927,
      "pose_rmse_dtheta": 0.1629498153924942,
      "pose_rmse_dx": 0.03966042771935463,
      "pose_rmse_dy": 0.0429290346801281,
      "pose_rmse_mean": 0.08184643089771271,
      "rmse_dtheta": 0.02035694010555744,
      "rmse_dx": 0.004999248776584864,
      "rmse_dy": 0.0025185414124280214,
      "rmse_mean": 0.009291577152907848,
      "rotation_flip": 0.002851711120456457,
      "sparse_tokens": 32105.0,
      "step": 11175,
      "turn_loss": 0.05831131711602211,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.519234343058911,
      "grad_norm": 0.42491379380226135,
      "learning_rate": 1.185199644003332e-07,
      "loss": 0.082,
      "mae_dtheta": 0.00795823149383068,
      "mae_dx": 0.0015298537909984589,
      "mae_dy": 0.0015357567463070154,
      "pose_mae_dtheta": 0.05755775794386864,
      "pose_mae_dx": 0.017201630398631096,
      "pose_mae_dy": 0.019948169589042664,
      "pose_rmse_dtheta": 0.15074317157268524,
      "pose_rmse_dx": 0.050930190831422806,
      "pose_rmse_dy": 0.053309086710214615,
      "pose_rmse_mean": 0.08499415218830109,
      "rmse_dtheta": 0.020175330340862274,
      "rmse_dx": 0.0053542000241577625,
      "rmse_dy": 0.0036626006476581097,
      "rmse_mean": 0.00973071064800024,
      "rotation_flip": 0.002459419658407569,
      "sparse_tokens": 32089.0,
      "step": 11176,
      "turn_loss": 0.0640081986784935,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5192808028247538,
      "grad_norm": 0.3845292925834656,
      "learning_rate": 1.1823395448782471e-07,
      "loss": 0.0752,
      "mae_dtheta": 0.007808134891092777,
      "mae_dx": 0.0009692791500128806,
      "mae_dy": 0.0011372736189514399,
      "pose_mae_dtheta": 0.05558689683675766,
      "pose_mae_dx": 0.010004490613937378,
      "pose_mae_dy": 0.013726974837481976,
      "pose_rmse_dtheta": 0.20618349313735962,
      "pose_rmse_dx": 0.02592499554157257,
      "pose_rmse_dy": 0.03562572970986366,
      "pose_rmse_mean": 0.08924474567174911,
      "rmse_dtheta": 0.022308742627501488,
      "rmse_dx": 0.0029766226653009653,
      "rmse_dy": 0.0025543507654219866,
      "rmse_mean": 0.009279905818402767,
      "rotation_flip": 0.0016792610986158252,
      "sparse_tokens": 32153.0,
      "step": 11177,
      "turn_loss": 0.04750404506921768,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16238.0,
      "epoch": 0.5193272625905966,
      "grad_norm": 0.7064194679260254,
      "learning_rate": 1.1794828595983576e-07,
      "loss": 0.1068,
      "mae_dtheta": 0.028990156948566437,
      "mae_dx": 0.008705567568540573,
      "mae_dy": 0.0034346445463597775,
      "pose_mae_dtheta": 0.22245965898036957,
      "pose_mae_dx": 0.07815946638584137,
      "pose_mae_dy": 0.0465778186917305,
      "pose_rmse_dtheta": 0.42525774240493774,
      "pose_rmse_dx": 0.174876868724823,
      "pose_rmse_dy": 0.11007608473300934,
      "pose_rmse_mean": 0.23673689365386963,
      "rmse_dtheta": 0.04638068377971649,
      "rmse_dx": 0.01984238624572754,
      "rmse_dy": 0.006904373876750469,
      "rmse_mean": 0.02437581494450569,
      "rotation_flip": 0.009320905432105064,
      "sparse_tokens": 12961.0,
      "step": 11178,
      "turn_loss": 0.2311621904373169,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 8116.0,
      "epoch": 0.5193737223564393,
      "grad_norm": 0.3083784580230713,
      "learning_rate": 1.1766295883634427e-07,
      "loss": 0.0765,
      "mae_dtheta": 0.03427160158753395,
      "mae_dx": 0.010336320847272873,
      "mae_dy": 0.007262329570949078,
      "pose_mae_dtheta": 0.28027433156967163,
      "pose_mae_dx": 0.0718178078532219,
      "pose_mae_dy": 0.06263978034257889,
      "pose_rmse_dtheta": 0.5521208047866821,
      "pose_rmse_dx": 0.19861623644828796,
      "pose_rmse_dy": 0.1632784903049469,
      "pose_rmse_mean": 0.30467185378074646,
      "rmse_dtheta": 0.0562320239841938,
      "rmse_dx": 0.022337548434734344,
      "rmse_dy": 0.014516881667077541,
      "rmse_mean": 0.03102882020175457,
      "rotation_flip": 0.005571030545979738,
      "sparse_tokens": 6867.0,
      "step": 11179,
      "turn_loss": 0.29928988218307495,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5194201821222821,
      "grad_norm": 0.5342577695846558,
      "learning_rate": 1.1737797313730149e-07,
      "loss": 0.0941,
      "mae_dtheta": 0.01224606391042471,
      "mae_dx": 0.002636087592691183,
      "mae_dy": 0.003770352341234684,
      "pose_mae_dtheta": 0.08889608830213547,
      "pose_mae_dx": 0.02867061085999012,
      "pose_mae_dy": 0.03758171200752258,
      "pose_rmse_dtheta": 0.2649745047092438,
      "pose_rmse_dx": 0.07586512714624405,
      "pose_rmse_dy": 0.12102060765028,
      "pose_rmse_mean": 0.153953418135643,
      "rmse_dtheta": 0.028865214437246323,
      "rmse_dx": 0.007818890735507011,
      "rmse_dy": 0.008904028683900833,
      "rmse_mean": 0.015196043998003006,
      "rotation_flip": 0.003816793905571103,
      "sparse_tokens": 32089.0,
      "step": 11180,
      "turn_loss": 0.1080552488565445,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5194666418881249,
      "grad_norm": 0.4775667190551758,
      "learning_rate": 1.1709332888263869e-07,
      "loss": 0.0735,
      "mae_dtheta": 0.009551946073770523,
      "mae_dx": 0.002304475987330079,
      "mae_dy": 0.0022111732978373766,
      "pose_mae_dtheta": 0.06335273385047913,
      "pose_mae_dx": 0.023658618330955505,
      "pose_mae_dy": 0.02532789297401905,
      "pose_rmse_dtheta": 0.16741053760051727,
      "pose_rmse_dx": 0.06374241411685944,
      "pose_rmse_dy": 0.07212554663419724,
      "pose_rmse_mean": 0.10109283775091171,
      "rmse_dtheta": 0.022944005206227303,
      "rmse_dx": 0.007067670579999685,
      "rmse_dy": 0.005554952193051577,
      "rmse_mean": 0.011855542659759521,
      "rotation_flip": 0.005740057211369276,
      "sparse_tokens": 32153.0,
      "step": 11181,
      "turn_loss": 0.08776119351387024,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5195131016539677,
      "grad_norm": 0.3484133183956146,
      "learning_rate": 1.1680902609225941e-07,
      "loss": 0.0924,
      "mae_dtheta": 0.007323853205889463,
      "mae_dx": 0.0010594192426651716,
      "mae_dy": 0.0012860792921856046,
      "pose_mae_dtheta": 0.049471527338027954,
      "pose_mae_dx": 0.015014146454632282,
      "pose_mae_dy": 0.01929994486272335,
      "pose_rmse_dtheta": 0.1317918747663498,
      "pose_rmse_dx": 0.046715665608644485,
      "pose_rmse_dy": 0.054798517376184464,
      "pose_rmse_mean": 0.07776868343353271,
      "rmse_dtheta": 0.018177421763539314,
      "rmse_dx": 0.003814220428466797,
      "rmse_dy": 0.003373660147190094,
      "rmse_mean": 0.008455101400613785,
      "rotation_flip": 0.00047326076310127974,
      "sparse_tokens": 32089.0,
      "step": 11182,
      "turn_loss": 0.05156379193067551,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20065.0,
      "epoch": 0.5195595614198104,
      "grad_norm": 0.5068234801292419,
      "learning_rate": 1.1652506478604664e-07,
      "loss": 0.1085,
      "mae_dtheta": 0.026029935106635094,
      "mae_dx": 0.01531811524182558,
      "mae_dy": 0.003257628297433257,
      "pose_mae_dtheta": 0.20870885252952576,
      "pose_mae_dx": 0.12135453522205353,
      "pose_mae_dy": 0.04435797035694122,
      "pose_rmse_dtheta": 0.35438135266304016,
      "pose_rmse_dx": 0.26145613193511963,
      "pose_rmse_dy": 0.10288452357053757,
      "pose_rmse_mean": 0.23957400023937225,
      "rmse_dtheta": 0.04131125286221504,
      "rmse_dx": 0.028854385018348694,
      "rmse_dy": 0.006569369696080685,
      "rmse_mean": 0.0255783349275589,
      "rotation_flip": 0.008739076554775238,
      "sparse_tokens": 15001.0,
      "step": 11183,
      "turn_loss": 0.22326479852199554,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.5196060211856532,
      "grad_norm": 0.6741266250610352,
      "learning_rate": 1.162414449838567e-07,
      "loss": 0.084,
      "mae_dtheta": 0.03927113488316536,
      "mae_dx": 0.01469359826296568,
      "mae_dy": 0.005536189302802086,
      "pose_mae_dtheta": 0.325887531042099,
      "pose_mae_dx": 0.09757763892412186,
      "pose_mae_dy": 0.06633299589157104,
      "pose_rmse_dtheta": 0.5764927268028259,
      "pose_rmse_dx": 0.2167402058839798,
      "pose_rmse_dy": 0.16380931437015533,
      "pose_rmse_mean": 0.3190140724182129,
      "rmse_dtheta": 0.05738482251763344,
      "rmse_dx": 0.027071082964539528,
      "rmse_dy": 0.011171910911798477,
      "rmse_mean": 0.031875938177108765,
      "rotation_flip": 0.022900763899087906,
      "sparse_tokens": 6300.0,
      "step": 11184,
      "turn_loss": 0.29710859060287476,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.519652480951496,
      "grad_norm": 0.44003549218177795,
      "learning_rate": 1.1595816670552429e-07,
      "loss": 0.0866,
      "mae_dtheta": 0.009350831620395184,
      "mae_dx": 0.0015804653521627188,
      "mae_dy": 0.0015666806139051914,
      "pose_mae_dtheta": 0.060030288994312286,
      "pose_mae_dx": 0.014088003896176815,
      "pose_mae_dy": 0.015385329723358154,
      "pose_rmse_dtheta": 0.20835700631141663,
      "pose_rmse_dx": 0.029081610962748528,
      "pose_rmse_dy": 0.03773893788456917,
      "pose_rmse_mean": 0.09172585606575012,
      "rmse_dtheta": 0.023715682327747345,
      "rmse_dx": 0.004276616033166647,
      "rmse_dy": 0.0035408996045589447,
      "rmse_mean": 0.01051106583327055,
      "rotation_flip": 0.005142269656062126,
      "sparse_tokens": 32249.0,
      "step": 11185,
      "turn_loss": 0.06522901356220245,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.5196989407173388,
      "grad_norm": 0.41224658489227295,
      "learning_rate": 1.1567522997085856e-07,
      "loss": 0.0886,
      "mae_dtheta": 0.0353035144507885,
      "mae_dx": 0.008261160925030708,
      "mae_dy": 0.00550768943503499,
      "pose_mae_dtheta": 0.26534828543663025,
      "pose_mae_dx": 0.07091490924358368,
      "pose_mae_dy": 0.06676604598760605,
      "pose_rmse_dtheta": 0.4737726151943207,
      "pose_rmse_dx": 0.16657765209674835,
      "pose_rmse_dy": 0.16653862595558167,
      "pose_rmse_mean": 0.2689629793167114,
      "rmse_dtheta": 0.053600527346134186,
      "rmse_dx": 0.018927881494164467,
      "rmse_dy": 0.010798118077218533,
      "rmse_mean": 0.027775509282946587,
      "rotation_flip": 0.011437908746302128,
      "sparse_tokens": 19960.0,
      "step": 11186,
      "turn_loss": 0.24493461847305298,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 25557.0,
      "epoch": 0.5197454004831815,
      "grad_norm": 0.5277903079986572,
      "learning_rate": 1.1539263479964535e-07,
      "loss": 0.1515,
      "mae_dtheta": 0.036449581384658813,
      "mae_dx": 0.011186602525413036,
      "mae_dy": 0.006782918702811003,
      "pose_mae_dtheta": 0.2799187898635864,
      "pose_mae_dx": 0.10314223915338516,
      "pose_mae_dy": 0.08606405556201935,
      "pose_rmse_dtheta": 0.48470982909202576,
      "pose_rmse_dx": 0.2298247516155243,
      "pose_rmse_dy": 0.1975441575050354,
      "pose_rmse_mean": 0.3040262460708618,
      "rmse_dtheta": 0.0542188435792923,
      "rmse_dx": 0.02271653153002262,
      "rmse_dy": 0.013409730046987534,
      "rmse_mean": 0.0301150344312191,
      "rotation_flip": 0.02166377753019333,
      "sparse_tokens": 19944.0,
      "step": 11187,
      "turn_loss": 0.2842728793621063,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5197918602490244,
      "grad_norm": 0.45547086000442505,
      "learning_rate": 1.1511038121164719e-07,
      "loss": 0.112,
      "mae_dtheta": 0.006957953795790672,
      "mae_dx": 0.0014198716962710023,
      "mae_dy": 0.0016042273491621017,
      "pose_mae_dtheta": 0.051421090960502625,
      "pose_mae_dx": 0.015850462019443512,
      "pose_mae_dy": 0.018321530893445015,
      "pose_rmse_dtheta": 0.13839440047740936,
      "pose_rmse_dx": 0.050710566341876984,
      "pose_rmse_dy": 0.04563597962260246,
      "pose_rmse_mean": 0.07824698835611343,
      "rmse_dtheta": 0.01653430052101612,
      "rmse_dx": 0.004866671748459339,
      "rmse_dy": 0.0038847397081553936,
      "rmse_mean": 0.008428571745753288,
      "rotation_flip": 0.0016251354245468974,
      "sparse_tokens": 32073.0,
      "step": 11188,
      "turn_loss": 0.06222044676542282,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5198383200148671,
      "grad_norm": 0.5861998200416565,
      "learning_rate": 1.1482846922660162e-07,
      "loss": 0.1218,
      "mae_dtheta": 0.005853724665939808,
      "mae_dx": 0.0010066087124869227,
      "mae_dy": 0.0014222521567717195,
      "pose_mae_dtheta": 0.03889075294137001,
      "pose_mae_dx": 0.011170264333486557,
      "pose_mae_dy": 0.017114246264100075,
      "pose_rmse_dtheta": 0.09161455184221268,
      "pose_rmse_dx": 0.030243096873164177,
      "pose_rmse_dy": 0.043855514377355576,
      "pose_rmse_mean": 0.055237721651792526,
      "rmse_dtheta": 0.013974872417747974,
      "rmse_dx": 0.0031248177401721478,
      "rmse_dy": 0.0033558858558535576,
      "rmse_mean": 0.006818525493144989,
      "rotation_flip": 0.007778318133205175,
      "sparse_tokens": 32089.0,
      "step": 11189,
      "turn_loss": 0.0459899865090847,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5198847797807099,
      "grad_norm": 0.404807984828949,
      "learning_rate": 1.1454689886422343e-07,
      "loss": 0.1099,
      "mae_dtheta": 0.008300289511680603,
      "mae_dx": 0.0013167803408578038,
      "mae_dy": 0.0023940394166857004,
      "pose_mae_dtheta": 0.05269849672913551,
      "pose_mae_dx": 0.019389472901821136,
      "pose_mae_dy": 0.025136787444353104,
      "pose_rmse_dtheta": 0.13599301874637604,
      "pose_rmse_dx": 0.06457462906837463,
      "pose_rmse_dy": 0.06814949214458466,
      "pose_rmse_mean": 0.08957238495349884,
      "rmse_dtheta": 0.01877063512802124,
      "rmse_dx": 0.00381156662479043,
      "rmse_dy": 0.005538160912692547,
      "rmse_mean": 0.009373454377055168,
      "rotation_flip": 0.0063821300864219666,
      "sparse_tokens": 32057.0,
      "step": 11190,
      "turn_loss": 0.06978105008602142,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5199312395465527,
      "grad_norm": 0.5851359963417053,
      "learning_rate": 1.1426567014420297e-07,
      "loss": 0.1452,
      "mae_dtheta": 0.008298436179757118,
      "mae_dx": 0.0018007704056799412,
      "mae_dy": 0.0016679366817697883,
      "pose_mae_dtheta": 0.055472955107688904,
      "pose_mae_dx": 0.018267491832375526,
      "pose_mae_dy": 0.01913263089954853,
      "pose_rmse_dtheta": 0.15817072987556458,
      "pose_rmse_dx": 0.05450243502855301,
      "pose_rmse_dy": 0.04815459996461868,
      "pose_rmse_mean": 0.08694258332252502,
      "rmse_dtheta": 0.020792707800865173,
      "rmse_dx": 0.006365564186125994,
      "rmse_dy": 0.00466194748878479,
      "rmse_mean": 0.010606739670038223,
      "rotation_flip": 0.005300353281199932,
      "sparse_tokens": 32121.0,
      "step": 11191,
      "turn_loss": 0.07122107595205307,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.5199776993123955,
      "grad_norm": 0.5654733180999756,
      "learning_rate": 1.139847830862062e-07,
      "loss": 0.2124,
      "mae_dtheta": 0.03963610529899597,
      "mae_dx": 0.008772740140557289,
      "mae_dy": 0.004988487809896469,
      "pose_mae_dtheta": 0.32115665078163147,
      "pose_mae_dx": 0.07470661401748657,
      "pose_mae_dy": 0.0774708092212677,
      "pose_rmse_dtheta": 0.5283873081207275,
      "pose_rmse_dx": 0.16417904198169708,
      "pose_rmse_dy": 0.17246639728546143,
      "pose_rmse_mean": 0.28834426403045654,
      "rmse_dtheta": 0.05817143991589546,
      "rmse_dx": 0.0191641915589571,
      "rmse_dy": 0.00967402569949627,
      "rmse_mean": 0.029003221541643143,
      "rotation_flip": 0.015094339847564697,
      "sparse_tokens": 17142.0,
      "step": 11192,
      "turn_loss": 0.306059330701828,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5200241590782383,
      "grad_norm": 0.40958860516548157,
      "learning_rate": 1.137042377098757e-07,
      "loss": 0.0896,
      "mae_dtheta": 0.014348605647683144,
      "mae_dx": 0.0026143931318074465,
      "mae_dy": 0.003819446312263608,
      "pose_mae_dtheta": 0.0920214056968689,
      "pose_mae_dx": 0.031549446284770966,
      "pose_mae_dy": 0.03843134641647339,
      "pose_rmse_dtheta": 0.2041807919740677,
      "pose_rmse_dx": 0.07459903508424759,
      "pose_rmse_dy": 0.08165615797042847,
      "pose_rmse_mean": 0.12014533579349518,
      "rmse_dtheta": 0.028090225532650948,
      "rmse_dx": 0.007431102450937033,
      "rmse_dy": 0.008630959317088127,
      "rmse_mean": 0.014717429876327515,
      "rotation_flip": 0.008248102851212025,
      "sparse_tokens": 32121.0,
      "step": 11193,
      "turn_loss": 0.13475359976291656,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.520070618844081,
      "grad_norm": 0.424638956785202,
      "learning_rate": 1.1342403403483137e-07,
      "loss": 0.0719,
      "mae_dtheta": 0.00869064312428236,
      "mae_dx": 0.0010575884953141212,
      "mae_dy": 0.0020862945821136236,
      "pose_mae_dtheta": 0.04789850860834122,
      "pose_mae_dx": 0.01518089510500431,
      "pose_mae_dy": 0.023299595341086388,
      "pose_rmse_dtheta": 0.09621351957321167,
      "pose_rmse_dx": 0.03768737241625786,
      "pose_rmse_dy": 0.053454551845788956,
      "pose_rmse_mean": 0.062451817095279694,
      "rmse_dtheta": 0.017120368778705597,
      "rmse_dx": 0.0033192276023328304,
      "rmse_dy": 0.004534011706709862,
      "rmse_mean": 0.008324536494910717,
      "rotation_flip": 0.004658385179936886,
      "sparse_tokens": 32089.0,
      "step": 11194,
      "turn_loss": 0.07031552493572235,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5201170786099238,
      "grad_norm": 0.45290297269821167,
      "learning_rate": 1.1314417208066641e-07,
      "loss": 0.0978,
      "mae_dtheta": 0.0061154491268098354,
      "mae_dx": 0.0014568534679710865,
      "mae_dy": 0.0009768708841875196,
      "pose_mae_dtheta": 0.04493403062224388,
      "pose_mae_dx": 0.015052162110805511,
      "pose_mae_dy": 0.01486965175718069,
      "pose_rmse_dtheta": 0.15291951596736908,
      "pose_rmse_dx": 0.053810667246580124,
      "pose_rmse_dy": 0.05549364909529686,
      "pose_rmse_mean": 0.08740794658660889,
      "rmse_dtheta": 0.019371304661035538,
      "rmse_dx": 0.006374511867761612,
      "rmse_dy": 0.002794796833768487,
      "rmse_mean": 0.00951353833079338,
      "rotation_flip": 0.0015060240402817726,
      "sparse_tokens": 32057.0,
      "step": 11195,
      "turn_loss": 0.053452447056770325,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.5201635383757666,
      "grad_norm": 0.6816282868385315,
      "learning_rate": 1.1286465186695294e-07,
      "loss": 0.1684,
      "mae_dtheta": 0.030548537150025368,
      "mae_dx": 0.007946125231683254,
      "mae_dy": 0.004577127285301685,
      "pose_mae_dtheta": 0.22098559141159058,
      "pose_mae_dx": 0.06345125287771225,
      "pose_mae_dy": 0.04797622561454773,
      "pose_rmse_dtheta": 0.4077192544937134,
      "pose_rmse_dx": 0.13938628137111664,
      "pose_rmse_dy": 0.11196547001600266,
      "pose_rmse_mean": 0.21969035267829895,
      "rmse_dtheta": 0.04945708066225052,
      "rmse_dx": 0.017696699127554893,
      "rmse_dy": 0.009451596066355705,
      "rmse_mean": 0.02553512714803219,
      "rotation_flip": 0.016236867755651474,
      "sparse_tokens": 18061.0,
      "step": 11196,
      "turn_loss": 0.20998181402683258,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 2309.0,
      "epoch": 0.5202099981416094,
      "grad_norm": 0.32543760538101196,
      "learning_rate": 1.12585473413237e-07,
      "loss": 0.0712,
      "mae_dtheta": 0.02194106951355934,
      "mae_dx": 0.01692647486925125,
      "mae_dy": 0.0057710641995072365,
      "pose_mae_dtheta": 0.1616818904876709,
      "pose_mae_dx": 0.11223787814378738,
      "pose_mae_dy": 0.07109583169221878,
      "pose_rmse_dtheta": 0.2557949125766754,
      "pose_rmse_dx": 0.20632608234882355,
      "pose_rmse_dy": 0.13735146820545197,
      "pose_rmse_mean": 0.19982415437698364,
      "rmse_dtheta": 0.03341590240597725,
      "rmse_dx": 0.029754195362329483,
      "rmse_dy": 0.009631061926484108,
      "rmse_mean": 0.024267053231596947,
      "rotation_flip": 0.01785714365541935,
      "sparse_tokens": 2000.0,
      "step": 11197,
      "turn_loss": 0.24517467617988586,
      "turns": 7.0,
      "turns_per_sample": 7.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5202564579074521,
      "grad_norm": 0.49627798795700073,
      "learning_rate": 1.123066367390424e-07,
      "loss": 0.1072,
      "mae_dtheta": 0.008326718583703041,
      "mae_dx": 0.000994245638139546,
      "mae_dy": 0.0013556891353800893,
      "pose_mae_dtheta": 0.052378736436367035,
      "pose_mae_dx": 0.011830620467662811,
      "pose_mae_dy": 0.018644364550709724,
      "pose_rmse_dtheta": 0.15099923312664032,
      "pose_rmse_dx": 0.035046644508838654,
      "pose_rmse_dy": 0.04336852580308914,
      "pose_rmse_mean": 0.0764714702963829,
      "rmse_dtheta": 0.01980242319405079,
      "rmse_dx": 0.003591442946344614,
      "rmse_dy": 0.002995039103552699,
      "rmse_mean": 0.008796301670372486,
      "rotation_flip": 0.0016970725264400244,
      "sparse_tokens": 32073.0,
      "step": 11198,
      "turn_loss": 0.05899377167224884,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.520302917673295,
      "grad_norm": 0.5284356474876404,
      "learning_rate": 1.1202814186386802e-07,
      "loss": 0.1115,
      "mae_dtheta": 0.006145013961941004,
      "mae_dx": 0.00122359290253371,
      "mae_dy": 0.0012664502719417214,
      "pose_mae_dtheta": 0.0401691235601902,
      "pose_mae_dx": 0.010583321563899517,
      "pose_mae_dy": 0.015794700011610985,
      "pose_rmse_dtheta": 0.11848346143960953,
      "pose_rmse_dx": 0.024978652596473694,
      "pose_rmse_dy": 0.04097438603639603,
      "pose_rmse_mean": 0.061478834599256516,
      "rmse_dtheta": 0.01614697463810444,
      "rmse_dx": 0.00357086886651814,
      "rmse_dy": 0.0041847978718578815,
      "rmse_mean": 0.00796754751354456,
      "rotation_flip": 0.005673758685588837,
      "sparse_tokens": 32137.0,
      "step": 11199,
      "turn_loss": 0.04777519032359123,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.5203493774391377,
      "grad_norm": 0.3916845917701721,
      "learning_rate": 1.1174998880718935e-07,
      "loss": 0.1202,
      "mae_dtheta": 0.029495788738131523,
      "mae_dx": 0.010426516644656658,
      "mae_dy": 0.007496960461139679,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3916846215724945,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.4504852294922,
      "model/head/act_norm_mean": 105.53256623641305,
      "model/head/act_norm_min": 62.758827209472656,
      "model/head/act_over_embed": 72.52296752911452,
      "model/head/grad_frac": 0.11794155091047287,
      "model/head/grad_norm": 0.04619589075446129,
      "model/head/grad_zero_frac": 0.00019988120766356587,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6981289628623188,
      "model/head/update_ratio": 0.0007863844512030482,
      "model/head/weight_delta": 9.98377513885498,
      "model/head/weight_delta_rel": 0.1751449853181839,
      "model/head/weight_norm": 58.74466323852539,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229069650173187,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228624071393694,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227678179740906,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905950050864038,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09141170233488083,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03580455854535103,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5413225446428571,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0011561098508536816,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1566219329833984,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313667356967926,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969860076904297,
      "model/modality_embedder/grad_frac": 0.09141170233488083,
      "model/modality_embedder/grad_norm": 0.03580455854535103,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5413225446428571,
      "model/modality_embedder/update_ratio": 0.0011561098508536816,
      "model/modality_embedder/weight_delta": 3.1566219329833984,
      "model/modality_embedder/weight_delta_rel": 0.10313667356967926,
      "model/modality_embedder/weight_norm": 30.969860076904297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.01105499267578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.25956478605935,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.234363555908203,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.984190680456368,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.054361239075660706,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.021292461082339287,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007615063223056495,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7415871620178223,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0999050885438919,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96097755432129,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.10546112060547,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.04000603864734,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.703436851501465,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.52051721584096,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.056553639471530914,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.022151190787553787,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00030765816336497664,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007440654444508255,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4759681224823,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12041025608778,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77048683166504,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 82.63249969482422,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.66599091327352,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.713690757751465,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.637909244394304,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05754595249891281,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.022539865225553513,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007331928354687989,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7657952308654785,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1264483481645584,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742069244384766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.08439636230469,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.603127875546352,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.437569618225098,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.96912790063017,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.050310179591178894,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.019705723971128464,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00037322466960176826,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.000657835800666362,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2369956970214844,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11062514781951904,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955385208129883,
      "model/normalizer/grad_frac": 0.17757926881313324,
      "model/normalizer/grad_norm": 0.06955506652593613,
      "model/normalizer/grad_zero_frac": 0.00031552414293400943,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0008842761162668467,
      "model/normalizer/weight_delta": 6.807463645935059,
      "model/normalizer/weight_delta_rel": 0.08767618983983994,
      "model/normalizer/weight_norm": 78.65763092041016,
      "pose_mae_dtheta": 0.19436530768871307,
      "pose_mae_dx": 0.08284903317689896,
      "pose_mae_dy": 0.07738419622182846,
      "pose_rmse_dtheta": 0.35585540533065796,
      "pose_rmse_dx": 0.19024060666561127,
      "pose_rmse_dy": 0.173292338848114,
      "pose_rmse_mean": 0.23979613184928894,
      "rmse_dtheta": 0.04599517956376076,
      "rmse_dx": 0.023385725915431976,
      "rmse_dy": 0.014520266093313694,
      "rmse_mean": 0.02796705812215805,
      "rotation_flip": 0.012416427955031395,
      "sparse_tokens": 18758.0,
      "step": 11200,
      "turn_loss": 0.31384187936782837,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "epoch": 0.5203493774391377,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30005142092704773,
      "eval_objectnav_nopose_mae_dtheta": 0.039555422961711884,
      "eval_objectnav_nopose_mae_dx": 0.012793926522135735,
      "eval_objectnav_nopose_mae_dy": 0.004895718302577734,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31578752398490906,
      "eval_objectnav_nopose_pose_mae_dx": 0.10289257764816284,
      "eval_objectnav_nopose_pose_mae_dy": 0.053448475897312164,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5335936546325684,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22752465307712555,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12652893364429474,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2958824038505554,
      "eval_objectnav_nopose_rmse_dtheta": 0.05725257843732834,
      "eval_objectnav_nopose_rmse_dx": 0.025283092632889748,
      "eval_objectnav_nopose_rmse_dy": 0.010172083973884583,
      "eval_objectnav_nopose_rmse_mean": 0.03090258501470089,
      "eval_objectnav_nopose_rotation_flip": 0.015242631547152996,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30005142092704773,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 11200
    },
    {
      "epoch": 0.5203493774391377,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2685614824295044,
      "eval_objectnav_pose_mae_dtheta": 0.034744106233119965,
      "eval_objectnav_pose_mae_dx": 0.010681149549782276,
      "eval_objectnav_pose_mae_dy": 0.00460346695035696,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2576659917831421,
      "eval_objectnav_pose_pose_mae_dx": 0.08314569294452667,
      "eval_objectnav_pose_pose_mae_dy": 0.04850560054183006,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45958518981933594,
      "eval_objectnav_pose_pose_rmse_dx": 0.19510993361473083,
      "eval_objectnav_pose_pose_rmse_dy": 0.11944090574979782,
      "eval_objectnav_pose_pose_rmse_mean": 0.25804537534713745,
      "eval_objectnav_pose_rmse_dtheta": 0.05263396352529526,
      "eval_objectnav_pose_rmse_dx": 0.022686384618282318,
      "eval_objectnav_pose_rmse_dy": 0.009715055115520954,
      "eval_objectnav_pose_rmse_mean": 0.0283451359719038,
      "eval_objectnav_pose_rotation_flip": 0.01506635919213295,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2685614824295044,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 11200
    },
    {
      "epoch": 0.5203493774391377,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08709981292486191,
      "eval_pointnav_mae_dtheta": 0.00972217507660389,
      "eval_pointnav_mae_dx": 0.002232316881418228,
      "eval_pointnav_mae_dy": 0.0022660507820546627,
      "eval_pointnav_pose_mae_dtheta": 0.06617478281259537,
      "eval_pointnav_pose_mae_dx": 0.023956216871738434,
      "eval_pointnav_pose_mae_dy": 0.023598046973347664,
      "eval_pointnav_pose_rmse_dtheta": 0.1927197128534317,
      "eval_pointnav_pose_rmse_dx": 0.07680975645780563,
      "eval_pointnav_pose_rmse_dy": 0.06827589124441147,
      "eval_pointnav_pose_rmse_mean": 0.11260178685188293,
      "eval_pointnav_rmse_dtheta": 0.024418199434876442,
      "eval_pointnav_rmse_dx": 0.0074209729209542274,
      "eval_pointnav_rmse_dy": 0.006083573214709759,
      "eval_pointnav_rmse_mean": 0.012640915811061859,
      "eval_pointnav_rotation_flip": 0.004704009275883436,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08709981292486191,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 11200
    },
    {
      "epoch": 0.5203493774391377,
      "eval_loss": 0.218570905427138,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30005142092704773,
      "eval_objectnav_nopose_mae_dtheta": 0.039555422961711884,
      "eval_objectnav_nopose_mae_dx": 0.012793926522135735,
      "eval_objectnav_nopose_mae_dy": 0.004895718302577734,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31578752398490906,
      "eval_objectnav_nopose_pose_mae_dx": 0.10289257764816284,
      "eval_objectnav_nopose_pose_mae_dy": 0.053448475897312164,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5335936546325684,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22752465307712555,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12652893364429474,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2958824038505554,
      "eval_objectnav_nopose_rmse_dtheta": 0.05725257843732834,
      "eval_objectnav_nopose_rmse_dx": 0.025283092632889748,
      "eval_objectnav_nopose_rmse_dy": 0.010172083973884583,
      "eval_objectnav_nopose_rmse_mean": 0.03090258501470089,
      "eval_objectnav_nopose_rotation_flip": 0.015242631547152996,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30005142092704773,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2685614824295044,
      "eval_objectnav_pose_mae_dtheta": 0.034744106233119965,
      "eval_objectnav_pose_mae_dx": 0.010681149549782276,
      "eval_objectnav_pose_mae_dy": 0.00460346695035696,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2576659917831421,
      "eval_objectnav_pose_pose_mae_dx": 0.08314569294452667,
      "eval_objectnav_pose_pose_mae_dy": 0.04850560054183006,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45958518981933594,
      "eval_objectnav_pose_pose_rmse_dx": 0.19510993361473083,
      "eval_objectnav_pose_pose_rmse_dy": 0.11944090574979782,
      "eval_objectnav_pose_pose_rmse_mean": 0.25804537534713745,
      "eval_objectnav_pose_rmse_dtheta": 0.05263396352529526,
      "eval_objectnav_pose_rmse_dx": 0.022686384618282318,
      "eval_objectnav_pose_rmse_dy": 0.009715055115520954,
      "eval_objectnav_pose_rmse_mean": 0.0283451359719038,
      "eval_objectnav_pose_rotation_flip": 0.01506635919213295,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2685614824295044,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08709981292486191,
      "eval_pointnav_mae_dtheta": 0.00972217507660389,
      "eval_pointnav_mae_dx": 0.002232316881418228,
      "eval_pointnav_mae_dy": 0.0022660507820546627,
      "eval_pointnav_pose_mae_dtheta": 0.06617478281259537,
      "eval_pointnav_pose_mae_dx": 0.023956216871738434,
      "eval_pointnav_pose_mae_dy": 0.023598046973347664,
      "eval_pointnav_pose_rmse_dtheta": 0.1927197128534317,
      "eval_pointnav_pose_rmse_dx": 0.07680975645780563,
      "eval_pointnav_pose_rmse_dy": 0.06827589124441147,
      "eval_pointnav_pose_rmse_mean": 0.11260178685188293,
      "eval_pointnav_rmse_dtheta": 0.024418199434876442,
      "eval_pointnav_rmse_dx": 0.0074209729209542274,
      "eval_pointnav_rmse_dy": 0.006083573214709759,
      "eval_pointnav_rmse_mean": 0.012640915811061859,
      "eval_pointnav_rotation_flip": 0.004704009275883436,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08709981292486191,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 11200
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.5203958372049805,
      "grad_norm": 0.8499361872673035,
      "learning_rate": 1.1147217758845752e-07,
      "loss": 0.1543,
      "mae_dtheta": 0.006816051434725523,
      "mae_dx": 0.001508197165094316,
      "mae_dy": 0.0011419962393119931,
      "pose_mae_dtheta": 0.04429974779486656,
      "pose_mae_dx": 0.014307815581560135,
      "pose_mae_dy": 0.016387471929192543,
      "pose_rmse_dtheta": 0.10482508689165115,
      "pose_rmse_dx": 0.037173762917518616,
      "pose_rmse_dy": 0.039589546620845795,
      "pose_rmse_mean": 0.060529470443725586,
      "rmse_dtheta": 0.01594802364706993,
      "rmse_dx": 0.004583106376230717,
      "rmse_dy": 0.002515306929126382,
      "rmse_mean": 0.007682145573198795,
      "rotation_flip": 0.00242816680110991,
      "sparse_tokens": 32201.0,
      "step": 11201,
      "turn_loss": 0.049790360033512115,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5204422969708232,
      "grad_norm": 0.4062887132167816,
      "learning_rate": 1.1119470822709977e-07,
      "loss": 0.1341,
      "mae_dtheta": 0.006750556640326977,
      "mae_dx": 0.0014214341063052416,
      "mae_dy": 0.001215537660755217,
      "pose_mae_dtheta": 0.04717755690217018,
      "pose_mae_dx": 0.013058596290647984,
      "pose_mae_dy": 0.012105422094464302,
      "pose_rmse_dtheta": 0.17601856589317322,
      "pose_rmse_dx": 0.03199748322367668,
      "pose_rmse_dy": 0.032958198338747025,
      "pose_rmse_mean": 0.08032475411891937,
      "rmse_dtheta": 0.020070765167474747,
      "rmse_dx": 0.003950257319957018,
      "rmse_dy": 0.0032082872930914164,
      "rmse_mean": 0.0090764369815588,
      "rotation_flip": 0.007525870110839605,
      "sparse_tokens": 32185.0,
      "step": 11202,
      "turn_loss": 0.06343163549900055,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5204887567366661,
      "grad_norm": 0.4154483675956726,
      "learning_rate": 1.1091758074252112e-07,
      "loss": 0.0947,
      "mae_dtheta": 0.010884536430239677,
      "mae_dx": 0.0015026963083073497,
      "mae_dy": 0.002613853197544813,
      "pose_mae_dtheta": 0.07539809495210648,
      "pose_mae_dx": 0.02326570451259613,
      "pose_mae_dy": 0.0323825404047966,
      "pose_rmse_dtheta": 0.1715446263551712,
      "pose_rmse_dx": 0.06528521329164505,
      "pose_rmse_dy": 0.08216515928506851,
      "pose_rmse_mean": 0.10633166879415512,
      "rmse_dtheta": 0.022128304466605186,
      "rmse_dx": 0.00484198983758688,
      "rmse_dy": 0.006245274096727371,
      "rmse_mean": 0.011071856133639812,
      "rotation_flip": 0.00643604202196002,
      "sparse_tokens": 32041.0,
      "step": 11203,
      "turn_loss": 0.099007748067379,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.5205352165025088,
      "grad_norm": 0.8603425621986389,
      "learning_rate": 1.1064079515409942e-07,
      "loss": 0.127,
      "mae_dtheta": 0.028276953846216202,
      "mae_dx": 0.010317563079297543,
      "mae_dy": 0.002765716053545475,
      "pose_mae_dtheta": 0.20747511088848114,
      "pose_mae_dx": 0.0781460627913475,
      "pose_mae_dy": 0.026803400367498398,
      "pose_rmse_dtheta": 0.40441179275512695,
      "pose_rmse_dx": 0.18437719345092773,
      "pose_rmse_dy": 0.06627573817968369,
      "pose_rmse_mean": 0.21835491061210632,
      "rmse_dtheta": 0.04693175479769707,
      "rmse_dx": 0.021726323291659355,
      "rmse_dy": 0.006317581981420517,
      "rmse_mean": 0.02499188482761383,
      "rotation_flip": 0.005604483652859926,
      "sparse_tokens": 22796.0,
      "step": 11204,
      "turn_loss": 0.17773953080177307,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5205816762683516,
      "grad_norm": 0.4268690049648285,
      "learning_rate": 1.1036435148119085e-07,
      "loss": 0.1272,
      "mae_dtheta": 0.011502795852720737,
      "mae_dx": 0.0036389378365129232,
      "mae_dy": 0.004835089202970266,
      "pose_mae_dtheta": 0.08716921508312225,
      "pose_mae_dx": 0.042965907603502274,
      "pose_mae_dy": 0.03654506430029869,
      "pose_rmse_dtheta": 0.17701928317546844,
      "pose_rmse_dx": 0.10333146154880524,
      "pose_rmse_dy": 0.0808228999376297,
      "pose_rmse_mean": 0.12039121240377426,
      "rmse_dtheta": 0.023750850930809975,
      "rmse_dx": 0.008894284255802631,
      "rmse_dy": 0.010682446882128716,
      "rmse_mean": 0.01444252859801054,
      "rotation_flip": 0.0048971595242619514,
      "sparse_tokens": 32137.0,
      "step": 11205,
      "turn_loss": 0.1480851173400879,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.5206281360341943,
      "grad_norm": 0.5118241906166077,
      "learning_rate": 1.1008824974312827e-07,
      "loss": 0.108,
      "mae_dtheta": 0.022939030081033707,
      "mae_dx": 0.010217713192105293,
      "mae_dy": 0.0037642065435647964,
      "pose_mae_dtheta": 0.17409668862819672,
      "pose_mae_dx": 0.07575628161430359,
      "pose_mae_dy": 0.04907260462641716,
      "pose_rmse_dtheta": 0.3015257716178894,
      "pose_rmse_dx": 0.19184549152851105,
      "pose_rmse_dy": 0.12193938344717026,
      "pose_rmse_mean": 0.2051035463809967,
      "rmse_dtheta": 0.03686756268143654,
      "rmse_dx": 0.023141013458371162,
      "rmse_dy": 0.0077103846706449986,
      "rmse_mean": 0.022572986781597137,
      "rotation_flip": 0.012345679104328156,
      "sparse_tokens": 11043.0,
      "step": 11206,
      "turn_loss": 0.2123948484659195,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.5206745958000372,
      "grad_norm": 0.4992089867591858,
      "learning_rate": 1.0981248995921846e-07,
      "loss": 0.1582,
      "mae_dtheta": 0.03744851052761078,
      "mae_dx": 0.00818713940680027,
      "mae_dy": 0.004600373096764088,
      "pose_mae_dtheta": 0.30050671100616455,
      "pose_mae_dx": 0.0765669122338295,
      "pose_mae_dy": 0.04562821611762047,
      "pose_rmse_dtheta": 0.5060616731643677,
      "pose_rmse_dx": 0.1699424386024475,
      "pose_rmse_dy": 0.12376867979764938,
      "pose_rmse_mean": 0.26659095287323,
      "rmse_dtheta": 0.054610177874565125,
      "rmse_dx": 0.016855521127581596,
      "rmse_dy": 0.010292339138686657,
      "rmse_mean": 0.02725267969071865,
      "rotation_flip": 0.012411347590386868,
      "sparse_tokens": 10971.0,
      "step": 11207,
      "turn_loss": 0.2651694416999817,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 26847.0,
      "epoch": 0.52072105556588,
      "grad_norm": 0.4362081289291382,
      "learning_rate": 1.0953707214874654e-07,
      "loss": 0.1286,
      "mae_dtheta": 0.03705500811338425,
      "mae_dx": 0.011963332071900368,
      "mae_dy": 0.005527998320758343,
      "pose_mae_dtheta": 0.30289226770401,
      "pose_mae_dx": 0.0952962338924408,
      "pose_mae_dy": 0.06150858849287033,
      "pose_rmse_dtheta": 0.5140160918235779,
      "pose_rmse_dx": 0.20039232075214386,
      "pose_rmse_dy": 0.14665481448173523,
      "pose_rmse_mean": 0.28702110052108765,
      "rmse_dtheta": 0.05504103749990463,
      "rmse_dx": 0.02367166057229042,
      "rmse_dy": 0.011033132672309875,
      "rmse_mean": 0.029915278777480125,
      "rotation_flip": 0.012967200949788094,
      "sparse_tokens": 21199.0,
      "step": 11208,
      "turn_loss": 0.30105623602867126,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5207675153317227,
      "grad_norm": 0.415007621049881,
      "learning_rate": 1.0926199633097156e-07,
      "loss": 0.1017,
      "mae_dtheta": 0.008567897602915764,
      "mae_dx": 0.0009209124837070704,
      "mae_dy": 0.0019236268708482385,
      "pose_mae_dtheta": 0.04936115816235542,
      "pose_mae_dx": 0.01447534654289484,
      "pose_mae_dy": 0.02454664558172226,
      "pose_rmse_dtheta": 0.09211897104978561,
      "pose_rmse_dx": 0.03491370007395744,
      "pose_rmse_dy": 0.05219981074333191,
      "pose_rmse_mean": 0.05974416062235832,
      "rmse_dtheta": 0.01604132354259491,
      "rmse_dx": 0.002928664442151785,
      "rmse_dy": 0.0040419925935566425,
      "rmse_mean": 0.007670660503208637,
      "rotation_flip": 0.0018525379709899426,
      "sparse_tokens": 32041.0,
      "step": 11209,
      "turn_loss": 0.06649024039506912,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.5208139750975656,
      "grad_norm": 1.480297565460205,
      "learning_rate": 1.0898726252513092e-07,
      "loss": 0.281,
      "mae_dtheta": 0.02219398133456707,
      "mae_dx": 0.008622086606919765,
      "mae_dy": 0.0018687709234654903,
      "pose_mae_dtheta": 0.16208679974079132,
      "pose_mae_dx": 0.0625823587179184,
      "pose_mae_dy": 0.017451295629143715,
      "pose_rmse_dtheta": 0.3626165986061096,
      "pose_rmse_dx": 0.1785103678703308,
      "pose_rmse_dy": 0.042224299162626266,
      "pose_rmse_mean": 0.19445042312145233,
      "rmse_dtheta": 0.04203777015209198,
      "rmse_dx": 0.02066999487578869,
      "rmse_dy": 0.004376739729195833,
      "rmse_mean": 0.022361502051353455,
      "rotation_flip": 0.003338898066431284,
      "sparse_tokens": 10047.0,
      "step": 11210,
      "turn_loss": 0.20615771412849426,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5208604348634083,
      "grad_norm": 0.4607647657394409,
      "learning_rate": 1.0871287075043534e-07,
      "loss": 0.0679,
      "mae_dtheta": 0.004582488443702459,
      "mae_dx": 0.001378549262881279,
      "mae_dy": 0.0009719759691506624,
      "pose_mae_dtheta": 0.029916591942310333,
      "pose_mae_dx": 0.011079411953687668,
      "pose_mae_dy": 0.01033130194991827,
      "pose_rmse_dtheta": 0.10022629052400589,
      "pose_rmse_dx": 0.04299640282988548,
      "pose_rmse_dy": 0.03046328015625477,
      "pose_rmse_mean": 0.05789532512426376,
      "rmse_dtheta": 0.014438520185649395,
      "rmse_dx": 0.0058077676221728325,
      "rmse_dy": 0.003079114481806755,
      "rmse_mean": 0.007775134406983852,
      "rotation_flip": 0.005196733400225639,
      "sparse_tokens": 32073.0,
      "step": 11211,
      "turn_loss": 0.03369477018713951,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.5209068946292511,
      "grad_norm": 0.444203644990921,
      "learning_rate": 1.084388210260745e-07,
      "loss": 0.1356,
      "mae_dtheta": 0.036988433450460434,
      "mae_dx": 0.009386537596583366,
      "mae_dy": 0.006286480464041233,
      "pose_mae_dtheta": 0.2762886881828308,
      "pose_mae_dx": 0.0796901062130928,
      "pose_mae_dy": 0.0867876261472702,
      "pose_rmse_dtheta": 0.46987417340278625,
      "pose_rmse_dx": 0.1821667104959488,
      "pose_rmse_dy": 0.1751307100057602,
      "pose_rmse_mean": 0.2757238745689392,
      "rmse_dtheta": 0.053900860249996185,
      "rmse_dx": 0.020948415622115135,
      "rmse_dy": 0.010914596728980541,
      "rmse_mean": 0.028587957844138145,
      "rotation_flip": 0.01461988314986229,
      "sparse_tokens": 10367.0,
      "step": 11212,
      "turn_loss": 0.2316926121711731,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 10374.0,
      "epoch": 0.5209533543950938,
      "grad_norm": 0.6380816102027893,
      "learning_rate": 1.081651133712125e-07,
      "loss": 0.1413,
      "mae_dtheta": 0.028879323974251747,
      "mae_dx": 0.013521714136004448,
      "mae_dy": 0.003865416394546628,
      "pose_mae_dtheta": 0.22168231010437012,
      "pose_mae_dx": 0.10870116204023361,
      "pose_mae_dy": 0.048908982425928116,
      "pose_rmse_dtheta": 0.38436147570610046,
      "pose_rmse_dx": 0.226676344871521,
      "pose_rmse_dy": 0.09814281761646271,
      "pose_rmse_mean": 0.23639355599880219,
      "rmse_dtheta": 0.044812485575675964,
      "rmse_dx": 0.025441192090511322,
      "rmse_dy": 0.007179860956966877,
      "rmse_mean": 0.025811180472373962,
      "rotation_flip": 0.019313305616378784,
      "sparse_tokens": 8808.0,
      "step": 11213,
      "turn_loss": 0.1883159726858139,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5209998141609367,
      "grad_norm": 0.347197026014328,
      "learning_rate": 1.0789174780498902e-07,
      "loss": 0.0531,
      "mae_dtheta": 0.004993840120732784,
      "mae_dx": 0.0012753433547914028,
      "mae_dy": 0.00048600841546431184,
      "pose_mae_dtheta": 0.03764762356877327,
      "pose_mae_dx": 0.009286698885262012,
      "pose_mae_dy": 0.007962100207805634,
      "pose_rmse_dtheta": 0.14044561982154846,
      "pose_rmse_dx": 0.028450140729546547,
      "pose_rmse_dy": 0.020455488935112953,
      "pose_rmse_mean": 0.06311708688735962,
      "rmse_dtheta": 0.016243038699030876,
      "rmse_dx": 0.004827274475246668,
      "rmse_dy": 0.0010506738908588886,
      "rmse_mean": 0.0073736621998250484,
      "rotation_flip": 0.0,
      "sparse_tokens": 32105.0,
      "step": 11214,
      "turn_loss": 0.03535161539912224,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5210462739267794,
      "grad_norm": 0.4802619218826294,
      "learning_rate": 1.076187243465221e-07,
      "loss": 0.1096,
      "mae_dtheta": 0.009440498426556587,
      "mae_dx": 0.00195496017113328,
      "mae_dy": 0.002193101681768894,
      "pose_mae_dtheta": 0.06694096326828003,
      "pose_mae_dx": 0.016262946650385857,
      "pose_mae_dy": 0.022020399570465088,
      "pose_rmse_dtheta": 0.1766199767589569,
      "pose_rmse_dx": 0.046804264187812805,
      "pose_rmse_dy": 0.05891774594783783,
      "pose_rmse_mean": 0.09411399811506271,
      "rmse_dtheta": 0.023039111867547035,
      "rmse_dx": 0.005822489503771067,
      "rmse_dy": 0.006947802379727364,
      "rmse_mean": 0.011936469003558159,
      "rotation_flip": 0.0026780932676047087,
      "sparse_tokens": 32073.0,
      "step": 11215,
      "turn_loss": 0.08648130297660828,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5210927336926222,
      "grad_norm": 0.3406764566898346,
      "learning_rate": 1.0734604301490315e-07,
      "loss": 0.0708,
      "mae_dtheta": 0.009704520925879478,
      "mae_dx": 0.0017361646750941873,
      "mae_dy": 0.0018414341611787677,
      "pose_mae_dtheta": 0.06740812212228775,
      "pose_mae_dx": 0.0195552259683609,
      "pose_mae_dy": 0.022126492112874985,
      "pose_rmse_dtheta": 0.20419996976852417,
      "pose_rmse_dx": 0.05681651830673218,
      "pose_rmse_dy": 0.0619598850607872,
      "pose_rmse_mean": 0.10765879601240158,
      "rmse_dtheta": 0.022900203242897987,
      "rmse_dx": 0.005613554734736681,
      "rmse_dy": 0.004802714101970196,
      "rmse_mean": 0.01110549084842205,
      "rotation_flip": 0.005245588719844818,
      "sparse_tokens": 32089.0,
      "step": 11216,
      "turn_loss": 0.07104107737541199,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.5211391934584649,
      "grad_norm": 0.54465651512146,
      "learning_rate": 1.070737038292019e-07,
      "loss": 0.1378,
      "mae_dtheta": 0.04690127074718475,
      "mae_dx": 0.011637535877525806,
      "mae_dy": 0.0046793813817203045,
      "pose_mae_dtheta": 0.4042568802833557,
      "pose_mae_dx": 0.08854539692401886,
      "pose_mae_dy": 0.0574740394949913,
      "pose_rmse_dtheta": 0.6738911271095276,
      "pose_rmse_dx": 0.1875031590461731,
      "pose_rmse_dy": 0.17161999642848969,
      "pose_rmse_mean": 0.3443381190299988,
      "rmse_dtheta": 0.06803005933761597,
      "rmse_dx": 0.023710209876298904,
      "rmse_dy": 0.010233516804873943,
      "rmse_mean": 0.033991262316703796,
      "rotation_flip": 0.024752475321292877,
      "sparse_tokens": 6390.0,
      "step": 11217,
      "turn_loss": 0.3530759811401367,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.5211856532243078,
      "grad_norm": 0.5343296527862549,
      "learning_rate": 1.0680170680846259e-07,
      "loss": 0.0847,
      "mae_dtheta": 0.030979372560977936,
      "mae_dx": 0.013364440761506557,
      "mae_dy": 0.004385263193398714,
      "pose_mae_dtheta": 0.24580363929271698,
      "pose_mae_dx": 0.11126691848039627,
      "pose_mae_dy": 0.05197596922516823,
      "pose_rmse_dtheta": 0.44025328755378723,
      "pose_rmse_dx": 0.23797409236431122,
      "pose_rmse_dy": 0.11562619358301163,
      "pose_rmse_mean": 0.2646178603172302,
      "rmse_dtheta": 0.048725441098213196,
      "rmse_dx": 0.025732699781656265,
      "rmse_dy": 0.007773878518491983,
      "rmse_mean": 0.02741067111492157,
      "rotation_flip": 0.010498687624931335,
      "sparse_tokens": 8438.0,
      "step": 11218,
      "turn_loss": 0.19253987073898315,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5212321129901505,
      "grad_norm": 0.3719216287136078,
      "learning_rate": 1.0653005197170663e-07,
      "loss": 0.0869,
      "mae_dtheta": 0.008470656350255013,
      "mae_dx": 0.0012876123655587435,
      "mae_dy": 0.0012324461713433266,
      "pose_mae_dtheta": 0.05318477004766464,
      "pose_mae_dx": 0.012277290225028992,
      "pose_mae_dy": 0.012937476858496666,
      "pose_rmse_dtheta": 0.17462962865829468,
      "pose_rmse_dx": 0.028403524309396744,
      "pose_rmse_dy": 0.03478604555130005,
      "pose_rmse_mean": 0.07927306741476059,
      "rmse_dtheta": 0.024932149797677994,
      "rmse_dx": 0.0036674158181995153,
      "rmse_dy": 0.003593565197661519,
      "rmse_mean": 0.010731044225394726,
      "rotation_flip": 0.0008591065416112542,
      "sparse_tokens": 32185.0,
      "step": 11219,
      "turn_loss": 0.0570802204310894,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.5212785727559933,
      "grad_norm": 0.48417311906814575,
      "learning_rate": 1.0625873933792997e-07,
      "loss": 0.1147,
      "mae_dtheta": 0.041664477437734604,
      "mae_dx": 0.014814312569797039,
      "mae_dy": 0.005110085476189852,
      "pose_mae_dtheta": 0.32679158449172974,
      "pose_mae_dx": 0.11373817920684814,
      "pose_mae_dy": 0.05938943475484848,
      "pose_rmse_dtheta": 0.5405287742614746,
      "pose_rmse_dx": 0.2363346517086029,
      "pose_rmse_dy": 0.14514951407909393,
      "pose_rmse_mean": 0.3073376715183258,
      "rmse_dtheta": 0.059199009090662,
      "rmse_dx": 0.027153320610523224,
      "rmse_dy": 0.011862560175359249,
      "rmse_mean": 0.032738298177719116,
      "rotation_flip": 0.01583113521337509,
      "sparse_tokens": 12314.0,
      "step": 11220,
      "turn_loss": 0.29211822152137756,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.521325032521836,
      "grad_norm": 0.46435433626174927,
      "learning_rate": 1.0598776892610685e-07,
      "loss": 0.1096,
      "mae_dtheta": 0.043028347194194794,
      "mae_dx": 0.011647725477814674,
      "mae_dy": 0.0047800783067941666,
      "pose_mae_dtheta": 0.3679782450199127,
      "pose_mae_dx": 0.08666461706161499,
      "pose_mae_dy": 0.06713873893022537,
      "pose_rmse_dtheta": 0.6418654322624207,
      "pose_rmse_dx": 0.1733773946762085,
      "pose_rmse_dy": 0.18043498694896698,
      "pose_rmse_mean": 0.33189260959625244,
      "rmse_dtheta": 0.06498313695192337,
      "rmse_dx": 0.023514458909630775,
      "rmse_dy": 0.010540617629885674,
      "rmse_mean": 0.033012740314006805,
      "rotation_flip": 0.004687500186264515,
      "sparse_tokens": 11255.0,
      "step": 11221,
      "turn_loss": 0.2293267548084259,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 7468.0,
      "epoch": 0.5213714922876789,
      "grad_norm": 0.32386332750320435,
      "learning_rate": 1.0571714075518491e-07,
      "loss": 0.0697,
      "mae_dtheta": 0.051529932767152786,
      "mae_dx": 0.011190847493708134,
      "mae_dy": 0.0039021496195346117,
      "pose_mae_dtheta": 0.4641422927379608,
      "pose_mae_dx": 0.07142138481140137,
      "pose_mae_dy": 0.04740124195814133,
      "pose_rmse_dtheta": 0.7359009981155396,
      "pose_rmse_dx": 0.19763609766960144,
      "pose_rmse_dy": 0.13456888496875763,
      "pose_rmse_mean": 0.35603535175323486,
      "rmse_dtheta": 0.07143694162368774,
      "rmse_dx": 0.02451472543179989,
      "rmse_dy": 0.009776514023542404,
      "rmse_mean": 0.035242728888988495,
      "rotation_flip": 0.03140096738934517,
      "sparse_tokens": 5745.0,
      "step": 11222,
      "turn_loss": 0.30846938490867615,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.5214179520535217,
      "grad_norm": 0.5474801063537598,
      "learning_rate": 1.0544685484409123e-07,
      "loss": 0.0774,
      "mae_dtheta": 0.008779063820838928,
      "mae_dx": 0.002084140432998538,
      "mae_dy": 0.0017218058928847313,
      "pose_mae_dtheta": 0.07063432782888412,
      "pose_mae_dx": 0.02073400840163231,
      "pose_mae_dy": 0.0218034815043211,
      "pose_rmse_dtheta": 0.20350946485996246,
      "pose_rmse_dx": 0.0730205625295639,
      "pose_rmse_dy": 0.06711244583129883,
      "pose_rmse_mean": 0.1145474910736084,
      "rmse_dtheta": 0.02342643402516842,
      "rmse_dx": 0.007451013196259737,
      "rmse_dy": 0.005429875571280718,
      "rmse_mean": 0.012102441862225533,
      "rotation_flip": 0.0029362416826188564,
      "sparse_tokens": 32217.0,
      "step": 11223,
      "turn_loss": 0.07620290666818619,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.5214644118193644,
      "grad_norm": 0.43405136466026306,
      "learning_rate": 1.0517691121172569e-07,
      "loss": 0.0926,
      "mae_dtheta": 0.03127402812242508,
      "mae_dx": 0.008251872844994068,
      "mae_dy": 0.005598430056124926,
      "pose_mae_dtheta": 0.21904727816581726,
      "pose_mae_dx": 0.07350685447454453,
      "pose_mae_dy": 0.057852283120155334,
      "pose_rmse_dtheta": 0.3577570915222168,
      "pose_rmse_dx": 0.1483238935470581,
      "pose_rmse_dy": 0.11374744772911072,
      "pose_rmse_mean": 0.20660948753356934,
      "rmse_dtheta": 0.044292811304330826,
      "rmse_dx": 0.016728103160858154,
      "rmse_dy": 0.008784906007349491,
      "rmse_mean": 0.02326860837638378,
      "rotation_flip": 0.02534562163054943,
      "sparse_tokens": 7216.0,
      "step": 11224,
      "turn_loss": 0.21859797835350037,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5215108715852073,
      "grad_norm": 0.583085298538208,
      "learning_rate": 1.0490730987696596e-07,
      "loss": 0.1424,
      "mae_dtheta": 0.010391783900558949,
      "mae_dx": 0.00179832405410707,
      "mae_dy": 0.002961003454402089,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.583085298538208,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 150.29507446289062,
      "model/head/act_norm_mean": 102.76917613636364,
      "model/head/act_norm_min": 48.41440963745117,
      "model/head/act_over_embed": 70.62393998109485,
      "model/head/grad_frac": 0.10656697303056717,
      "model/head/grad_norm": 0.06213763728737831,
      "model/head/grad_zero_frac": 0.00019829485972877592,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7110361426767676,
      "model/head/update_ratio": 0.001057757530361414,
      "model/head/weight_delta": 9.983983039855957,
      "model/head/weight_delta_rel": 0.1751486361026764,
      "model/head/weight_norm": 58.74468994140625,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.422943115234375,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42285973929503573,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42278343439102173,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059317171880095,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10372753441333771,
      "model/modality_embedder.encoders.pose/grad_norm": 0.060481999069452286,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5071994114349776,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019529311684891582,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1565370559692383,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1031339019536972,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96985626220703,
      "model/modality_embedder/grad_frac": 0.10372753441333771,
      "model/modality_embedder/grad_norm": 0.060481999069452286,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5071994114349776,
      "model/modality_embedder/update_ratio": 0.0019529311684891582,
      "model/modality_embedder/weight_delta": 3.1565370559692383,
      "model/modality_embedder/weight_delta_rel": 0.1031339019536972,
      "model/modality_embedder/weight_norm": 30.96985626220703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.57746124267578,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.943665323873656,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.08317756652832,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.767101612545,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07429645955562592,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04332117363810539,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015493413666263223,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7417075634002686,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0999094769358635,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96102523803711,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.32402801513672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.897571949655283,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.340021133422852,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.422635176396668,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08444759249687195,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.049240149557590485,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001653989078477025,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.476125717163086,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12041570991277695,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770540237426758,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.19485473632812,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.70452040243707,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.476776123046875,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.664387070066255,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08569881319999695,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04996971786022186,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016254481161013246,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.76595139503479,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12645359337329865,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.74211883544922,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.87146759033203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.476523669232,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.44299602508545,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.882124304763693,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09068801254034042,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.05287884548306465,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017148160259239376,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0017652499955147505,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2371788024902344,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11063140630722046,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955442428588867,
      "model/normalizer/grad_frac": 0.355526864528656,
      "model/normalizer/grad_norm": 0.20730248093605042,
      "model/normalizer/grad_zero_frac": 0.0002280755143146962,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0026355015579611063,
      "model/normalizer/weight_delta": 6.80778169631958,
      "model/normalizer/weight_delta_rel": 0.08768028765916824,
      "model/normalizer/weight_norm": 78.65769958496094,
      "pose_mae_dtheta": 0.06193098425865173,
      "pose_mae_dx": 0.016957689076662064,
      "pose_mae_dy": 0.022776374593377113,
      "pose_rmse_dtheta": 0.15962931513786316,
      "pose_rmse_dx": 0.052834656089544296,
      "pose_rmse_dy": 0.05119895935058594,
      "pose_rmse_mean": 0.08788764476776123,
      "rmse_dtheta": 0.023635728284716606,
      "rmse_dx": 0.005952369421720505,
      "rmse_dy": 0.008368609473109245,
      "rmse_mean": 0.01265223603695631,
      "rotation_flip": 0.0076540373265743256,
      "sparse_tokens": 32105.0,
      "step": 11225,
      "turn_loss": 0.10937755554914474,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.52155733135105,
      "grad_norm": 0.564837634563446,
      "learning_rate": 1.046380508586653e-07,
      "loss": 0.1578,
      "mae_dtheta": 0.03511078655719757,
      "mae_dx": 0.008772817440330982,
      "mae_dy": 0.005275546573102474,
      "pose_mae_dtheta": 0.2755149006843567,
      "pose_mae_dx": 0.07051683962345123,
      "pose_mae_dy": 0.053366731852293015,
      "pose_rmse_dtheta": 0.4758185148239136,
      "pose_rmse_dx": 0.15933233499526978,
      "pose_rmse_dy": 0.12185219675302505,
      "pose_rmse_mean": 0.2523343563079834,
      "rmse_dtheta": 0.05276855081319809,
      "rmse_dx": 0.01958736777305603,
      "rmse_dy": 0.011441082693636417,
      "rmse_mean": 0.027932334691286087,
      "rotation_flip": 0.01394585706293583,
      "sparse_tokens": 21699.0,
      "step": 11226,
      "turn_loss": 0.307269424200058,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5216037911168928,
      "grad_norm": 0.423797607421875,
      "learning_rate": 1.0436913417565364e-07,
      "loss": 0.0935,
      "mae_dtheta": 0.008656670339405537,
      "mae_dx": 0.0017861907836049795,
      "mae_dy": 0.001730908639729023,
      "pose_mae_dtheta": 0.060252562165260315,
      "pose_mae_dx": 0.021672850474715233,
      "pose_mae_dy": 0.023357922211289406,
      "pose_rmse_dtheta": 0.16717535257339478,
      "pose_rmse_dx": 0.062204353511333466,
      "pose_rmse_dy": 0.06371615827083588,
      "pose_rmse_mean": 0.0976986289024353,
      "rmse_dtheta": 0.02086494490504265,
      "rmse_dx": 0.006288474891334772,
      "rmse_dy": 0.0038977679796516895,
      "rmse_mean": 0.010350395925343037,
      "rotation_flip": 0.004017857369035482,
      "sparse_tokens": 32089.0,
      "step": 11227,
      "turn_loss": 0.06760814040899277,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36013.0,
      "epoch": 0.5216502508827355,
      "grad_norm": 0.5698621869087219,
      "learning_rate": 1.0410055984673595e-07,
      "loss": 0.1215,
      "mae_dtheta": 0.031049318611621857,
      "mae_dx": 0.010884741321206093,
      "mae_dy": 0.0043028127402067184,
      "pose_mae_dtheta": 0.22430172562599182,
      "pose_mae_dx": 0.08412014693021774,
      "pose_mae_dy": 0.0522376112639904,
      "pose_rmse_dtheta": 0.4235124886035919,
      "pose_rmse_dx": 0.2073223888874054,
      "pose_rmse_dy": 0.1219172403216362,
      "pose_rmse_mean": 0.25091737508773804,
      "rmse_dtheta": 0.04838458076119423,
      "rmse_dx": 0.024249937385320663,
      "rmse_dy": 0.008285452611744404,
      "rmse_mean": 0.02697332575917244,
      "rotation_flip": 0.021699819713830948,
      "sparse_tokens": 28528.0,
      "step": 11228,
      "turn_loss": 0.23873350024223328,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.5216967106485784,
      "grad_norm": 0.7078295946121216,
      "learning_rate": 1.0383232789069386e-07,
      "loss": 0.2133,
      "mae_dtheta": 0.02983403392136097,
      "mae_dx": 0.00907859206199646,
      "mae_dy": 0.0052712457254529,
      "pose_mae_dtheta": 0.23221783339977264,
      "pose_mae_dx": 0.08275347203016281,
      "pose_mae_dy": 0.0522146075963974,
      "pose_rmse_dtheta": 0.4148603677749634,
      "pose_rmse_dx": 0.20301982760429382,
      "pose_rmse_dy": 0.12450498342514038,
      "pose_rmse_mean": 0.24746173620224,
      "rmse_dtheta": 0.04748111963272095,
      "rmse_dx": 0.020772172138094902,
      "rmse_dy": 0.011903997510671616,
      "rmse_mean": 0.026719098910689354,
      "rotation_flip": 0.01159678865224123,
      "sparse_tokens": 20317.0,
      "step": 11229,
      "turn_loss": 0.26263779401779175,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5217431704144211,
      "grad_norm": 0.5394307374954224,
      "learning_rate": 1.035644383262846e-07,
      "loss": 0.1309,
      "mae_dtheta": 0.01587718352675438,
      "mae_dx": 0.001923132804222405,
      "mae_dy": 0.0038578680250793695,
      "pose_mae_dtheta": 0.09992019832134247,
      "pose_mae_dx": 0.033711399883031845,
      "pose_mae_dy": 0.043869759887456894,
      "pose_rmse_dtheta": 0.18934790790081024,
      "pose_rmse_dx": 0.07877687364816666,
      "pose_rmse_dy": 0.08678756654262543,
      "pose_rmse_mean": 0.11830411851406097,
      "rmse_dtheta": 0.02622145786881447,
      "rmse_dx": 0.004945217166095972,
      "rmse_dy": 0.006720060482621193,
      "rmse_mean": 0.01262891199439764,
      "rotation_flip": 0.00877449568361044,
      "sparse_tokens": 32073.0,
      "step": 11230,
      "turn_loss": 0.14206543564796448,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5217896301802639,
      "grad_norm": 0.588068962097168,
      "learning_rate": 1.0329689117224262e-07,
      "loss": 0.102,
      "mae_dtheta": 0.010896400548517704,
      "mae_dx": 0.0019594768527895212,
      "mae_dy": 0.0022324910387396812,
      "pose_mae_dtheta": 0.0810052827000618,
      "pose_mae_dx": 0.020361917093396187,
      "pose_mae_dy": 0.02354387566447258,
      "pose_rmse_dtheta": 0.22086025774478912,
      "pose_rmse_dx": 0.05262871831655502,
      "pose_rmse_dy": 0.06132521107792854,
      "pose_rmse_mean": 0.1116047352552414,
      "rmse_dtheta": 0.02672470174729824,
      "rmse_dx": 0.005144570488482714,
      "rmse_dy": 0.005778783932328224,
      "rmse_mean": 0.012549353763461113,
      "rotation_flip": 0.003958828281611204,
      "sparse_tokens": 32169.0,
      "step": 11231,
      "turn_loss": 0.08730556815862656,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11702.0,
      "epoch": 0.5218360899461066,
      "grad_norm": 0.6684281826019287,
      "learning_rate": 1.030296864472774e-07,
      "loss": 0.1258,
      "mae_dtheta": 0.02945900522172451,
      "mae_dx": 0.007934732362627983,
      "mae_dy": 0.0076806372962892056,
      "pose_mae_dtheta": 0.21232223510742188,
      "pose_mae_dx": 0.06672017276287079,
      "pose_mae_dy": 0.07808353006839752,
      "pose_rmse_dtheta": 0.38423335552215576,
      "pose_rmse_dx": 0.17949219048023224,
      "pose_rmse_dy": 0.16754107177257538,
      "pose_rmse_mean": 0.2437555491924286,
      "rmse_dtheta": 0.046170394867658615,
      "rmse_dx": 0.017773598432540894,
      "rmse_dy": 0.016431232914328575,
      "rmse_mean": 0.02679174393415451,
      "rotation_flip": 0.01337792631238699,
      "sparse_tokens": 9503.0,
      "step": 11232,
      "turn_loss": 0.32407039403915405,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.5218825497119495,
      "grad_norm": 0.6174655556678772,
      "learning_rate": 1.0276282417007399e-07,
      "loss": 0.1607,
      "mae_dtheta": 0.025294974446296692,
      "mae_dx": 0.0027145296335220337,
      "mae_dy": 0.0037799342535436153,
      "pose_mae_dtheta": 0.1996045857667923,
      "pose_mae_dx": 0.022435346618294716,
      "pose_mae_dy": 0.05130907893180847,
      "pose_rmse_dtheta": 0.3858813941478729,
      "pose_rmse_dx": 0.047689683735370636,
      "pose_rmse_dy": 0.12138300389051437,
      "pose_rmse_mean": 0.18498468399047852,
      "rmse_dtheta": 0.042745787650346756,
      "rmse_dx": 0.008124946616590023,
      "rmse_dy": 0.007640103343874216,
      "rmse_mean": 0.01950361393392086,
      "rotation_flip": 0.0139860138297081,
      "sparse_tokens": 8631.0,
      "step": 11233,
      "turn_loss": 0.1356838345527649,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 25634.0,
      "epoch": 0.5219290094777922,
      "grad_norm": 0.4907948076725006,
      "learning_rate": 1.0249630435929581e-07,
      "loss": 0.1045,
      "mae_dtheta": 0.0311772171407938,
      "mae_dx": 0.0112355537712574,
      "mae_dy": 0.0060872882604599,
      "pose_mae_dtheta": 0.22807049751281738,
      "pose_mae_dx": 0.09663891792297363,
      "pose_mae_dy": 0.05961855500936508,
      "pose_rmse_dtheta": 0.4074859619140625,
      "pose_rmse_dx": 0.2089577466249466,
      "pose_rmse_dy": 0.14449964463710785,
      "pose_rmse_mean": 0.2536478042602539,
      "rmse_dtheta": 0.049211204051971436,
      "rmse_dx": 0.022958233952522278,
      "rmse_dy": 0.01305682584643364,
      "rmse_mean": 0.028408756479620934,
      "rotation_flip": 0.012057878077030182,
      "sparse_tokens": 19758.0,
      "step": 11234,
      "turn_loss": 0.22978754341602325,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.521975469243635,
      "grad_norm": 0.6093230247497559,
      "learning_rate": 1.0223012703357904e-07,
      "loss": 0.1621,
      "mae_dtheta": 0.035288747400045395,
      "mae_dx": 0.008641500025987625,
      "mae_dy": 0.003643645206466317,
      "pose_mae_dtheta": 0.30264607071876526,
      "pose_mae_dx": 0.07136061042547226,
      "pose_mae_dy": 0.04661661013960838,
      "pose_rmse_dtheta": 0.5570200681686401,
      "pose_rmse_dx": 0.17123351991176605,
      "pose_rmse_dy": 0.11115888506174088,
      "pose_rmse_mean": 0.27980417013168335,
      "rmse_dtheta": 0.05523998662829399,
      "rmse_dx": 0.019648781046271324,
      "rmse_dy": 0.00674276752397418,
      "rmse_mean": 0.02721051126718521,
      "rotation_flip": 0.015706805512309074,
      "sparse_tokens": 17448.0,
      "step": 11235,
      "turn_loss": 0.24047206342220306,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.5220219290094777,
      "grad_norm": 0.508741557598114,
      "learning_rate": 1.0196429221153825e-07,
      "loss": 0.1264,
      "mae_dtheta": 0.02400270849466324,
      "mae_dx": 0.011683457531034946,
      "mae_dy": 0.0019739733543246984,
      "pose_mae_dtheta": 0.1774294525384903,
      "pose_mae_dx": 0.08658701926469803,
      "pose_mae_dy": 0.02344045601785183,
      "pose_rmse_dtheta": 0.3374995291233063,
      "pose_rmse_dx": 0.23929250240325928,
      "pose_rmse_dy": 0.06661548465490341,
      "pose_rmse_mean": 0.21446916460990906,
      "rmse_dtheta": 0.04267533868551254,
      "rmse_dx": 0.025346148759126663,
      "rmse_dy": 0.004257258493453264,
      "rmse_mean": 0.024092918261885643,
      "rotation_flip": 0.01084010861814022,
      "sparse_tokens": 7557.0,
      "step": 11236,
      "turn_loss": 0.20982547104358673,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5220683887753206,
      "grad_norm": 1.0187833309173584,
      "learning_rate": 1.0169879991176356e-07,
      "loss": 0.1597,
      "mae_dtheta": 0.01058916375041008,
      "mae_dx": 0.0017291021067649126,
      "mae_dy": 0.003228170797228813,
      "pose_mae_dtheta": 0.06880659610033035,
      "pose_mae_dx": 0.02509257011115551,
      "pose_mae_dy": 0.03271736949682236,
      "pose_rmse_dtheta": 0.17850545048713684,
      "pose_rmse_dx": 0.06517698615789413,
      "pose_rmse_dy": 0.07933991402387619,
      "pose_rmse_mean": 0.10767412185668945,
      "rmse_dtheta": 0.022584933787584305,
      "rmse_dx": 0.00450887018814683,
      "rmse_dy": 0.007364281918853521,
      "rmse_mean": 0.011486029252409935,
      "rotation_flip": 0.005306122358888388,
      "sparse_tokens": 32105.0,
      "step": 11237,
      "turn_loss": 0.10677091032266617,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.5221148485411633,
      "grad_norm": 0.621763288974762,
      "learning_rate": 1.014336501528207e-07,
      "loss": 0.2007,
      "mae_dtheta": 0.031752560287714005,
      "mae_dx": 0.005714488681405783,
      "mae_dy": 0.0048090750351548195,
      "pose_mae_dtheta": 0.2342357635498047,
      "pose_mae_dx": 0.04670405015349388,
      "pose_mae_dy": 0.050086040049791336,
      "pose_rmse_dtheta": 0.46553894877433777,
      "pose_rmse_dx": 0.11205945909023285,
      "pose_rmse_dy": 0.11517266929149628,
      "pose_rmse_mean": 0.23092369735240936,
      "rmse_dtheta": 0.05092296004295349,
      "rmse_dx": 0.012858881615102291,
      "rmse_dy": 0.010127352550625801,
      "rmse_mean": 0.024636399000883102,
      "rotation_flip": 0.007389162667095661,
      "sparse_tokens": 7166.0,
      "step": 11238,
      "turn_loss": 0.24599048495292664,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 14945.0,
      "epoch": 0.5221613083070061,
      "grad_norm": 0.5725076198577881,
      "learning_rate": 1.0116884295325202e-07,
      "loss": 0.1649,
      "mae_dtheta": 0.03157329186797142,
      "mae_dx": 0.009997805580496788,
      "mae_dy": 0.0035417310427874327,
      "pose_mae_dtheta": 0.21850113570690155,
      "pose_mae_dx": 0.07105608284473419,
      "pose_mae_dy": 0.05255470424890518,
      "pose_rmse_dtheta": 0.40450072288513184,
      "pose_rmse_dx": 0.16715949773788452,
      "pose_rmse_dy": 0.14094913005828857,
      "pose_rmse_mean": 0.2375364601612091,
      "rmse_dtheta": 0.05239374563097954,
      "rmse_dx": 0.02208697609603405,
      "rmse_dy": 0.007513618096709251,
      "rmse_mean": 0.02733144722878933,
      "rotation_flip": 0.011220196262001991,
      "sparse_tokens": 12205.0,
      "step": 11239,
      "turn_loss": 0.19756890833377838,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.522207768072849,
      "grad_norm": 0.43091315031051636,
      "learning_rate": 1.0090437833157552e-07,
      "loss": 0.0792,
      "mae_dtheta": 0.03806300461292267,
      "mae_dx": 0.02170822210609913,
      "mae_dy": 0.00463935686275363,
      "pose_mae_dtheta": 0.29257187247276306,
      "pose_mae_dx": 0.1340450942516327,
      "pose_mae_dy": 0.04881908372044563,
      "pose_rmse_dtheta": 0.569629430770874,
      "pose_rmse_dx": 0.2534143030643463,
      "pose_rmse_dy": 0.1393621414899826,
      "pose_rmse_mean": 0.3208019733428955,
      "rmse_dtheta": 0.057532355189323425,
      "rmse_dx": 0.03464827686548233,
      "rmse_dy": 0.009075694717466831,
      "rmse_mean": 0.03375210985541344,
      "rotation_flip": 0.0,
      "sparse_tokens": 2960.0,
      "step": 11240,
      "turn_loss": 0.24719128012657166,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5222542278386917,
      "grad_norm": 0.6094509363174438,
      "learning_rate": 1.0064025630628583e-07,
      "loss": 0.1411,
      "mae_dtheta": 0.00752630177885294,
      "mae_dx": 0.002383097307756543,
      "mae_dy": 0.0016260851407423615,
      "pose_mae_dtheta": 0.05095647647976875,
      "pose_mae_dx": 0.019897833466529846,
      "pose_mae_dy": 0.01988886296749115,
      "pose_rmse_dtheta": 0.16287508606910706,
      "pose_rmse_dx": 0.050371117889881134,
      "pose_rmse_dy": 0.0587027445435524,
      "pose_rmse_mean": 0.09064964950084686,
      "rmse_dtheta": 0.02082766406238079,
      "rmse_dx": 0.007317384704947472,
      "rmse_dy": 0.004046326503157616,
      "rmse_mean": 0.010730458423495293,
      "rotation_flip": 0.003842869307845831,
      "sparse_tokens": 32185.0,
      "step": 11241,
      "turn_loss": 0.08817725628614426,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.5223006876045345,
      "grad_norm": 0.5452906489372253,
      "learning_rate": 1.0037647689585207e-07,
      "loss": 0.112,
      "mae_dtheta": 0.030943114310503006,
      "mae_dx": 0.0067706056870520115,
      "mae_dy": 0.0041480460204184055,
      "pose_mae_dtheta": 0.20555323362350464,
      "pose_mae_dx": 0.05421687290072441,
      "pose_mae_dy": 0.053871165961027145,
      "pose_rmse_dtheta": 0.36879464983940125,
      "pose_rmse_dx": 0.15417876839637756,
      "pose_rmse_dy": 0.1323971003293991,
      "pose_rmse_mean": 0.21845684945583344,
      "rmse_dtheta": 0.05074296146631241,
      "rmse_dx": 0.018553752452135086,
      "rmse_dy": 0.007904336787760258,
      "rmse_mean": 0.02573368512094021,
      "rotation_flip": 0.007731958758085966,
      "sparse_tokens": 6662.0,
      "step": 11242,
      "turn_loss": 0.1582481414079666,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5223471473703772,
      "grad_norm": 0.43212106823921204,
      "learning_rate": 1.0011304011872113e-07,
      "loss": 0.1051,
      "mae_dtheta": 0.01500916387885809,
      "mae_dx": 0.0031917206943035126,
      "mae_dy": 0.0045038191601634026,
      "pose_mae_dtheta": 0.10243308544158936,
      "pose_mae_dx": 0.02649986930191517,
      "pose_mae_dy": 0.03401866555213928,
      "pose_rmse_dtheta": 0.26818710565567017,
      "pose_rmse_dx": 0.06497079133987427,
      "pose_rmse_dy": 0.07316247373819351,
      "pose_rmse_mean": 0.13544012606143951,
      "rmse_dtheta": 0.031056473031640053,
      "rmse_dx": 0.010778563097119331,
      "rmse_dy": 0.012348299846053123,
      "rmse_mean": 0.018061112612485886,
      "rotation_flip": 0.00856055784970522,
      "sparse_tokens": 32137.0,
      "step": 11243,
      "turn_loss": 0.15156666934490204,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5223936071362201,
      "grad_norm": 0.4530535936355591,
      "learning_rate": 9.984994599331555e-08,
      "loss": 0.1371,
      "mae_dtheta": 0.006780386436730623,
      "mae_dx": 0.0024713166058063507,
      "mae_dy": 0.0019327962072566152,
      "pose_mae_dtheta": 0.048568032681941986,
      "pose_mae_dx": 0.018980609253048897,
      "pose_mae_dy": 0.019877422600984573,
      "pose_rmse_dtheta": 0.1698216199874878,
      "pose_rmse_dx": 0.06281271576881409,
      "pose_rmse_dy": 0.08813811838626862,
      "pose_rmse_mean": 0.1069241613149643,
      "rmse_dtheta": 0.021031992509961128,
      "rmse_dx": 0.00838544126600027,
      "rmse_dy": 0.007154988590627909,
      "rmse_mean": 0.012190807610750198,
      "rotation_flip": 0.004115226212888956,
      "sparse_tokens": 32137.0,
      "step": 11244,
      "turn_loss": 0.0916123017668724,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5224400669020628,
      "grad_norm": 0.32944193482398987,
      "learning_rate": 9.958719453803278e-08,
      "loss": 0.0714,
      "mae_dtheta": 0.005676949396729469,
      "mae_dx": 0.0008146677864715457,
      "mae_dy": 0.000848079682327807,
      "pose_mae_dtheta": 0.03293387219309807,
      "pose_mae_dx": 0.007832343690097332,
      "pose_mae_dy": 0.011484939604997635,
      "pose_rmse_dtheta": 0.11161813884973526,
      "pose_rmse_dx": 0.018666446208953857,
      "pose_rmse_dy": 0.028482455760240555,
      "pose_rmse_mean": 0.05292234569787979,
      "rmse_dtheta": 0.017805887386202812,
      "rmse_dx": 0.0026221228763461113,
      "rmse_dy": 0.0019431207329034805,
      "rmse_mean": 0.007457043509930372,
      "rotation_flip": 0.0,
      "sparse_tokens": 32137.0,
      "step": 11245,
      "turn_loss": 0.046657610684633255,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5224865266679056,
      "grad_norm": 0.45590004324913025,
      "learning_rate": 9.932478577124815e-08,
      "loss": 0.1042,
      "mae_dtheta": 0.014186667278409004,
      "mae_dx": 0.003631218569353223,
      "mae_dy": 0.004396842326968908,
      "pose_mae_dtheta": 0.09718100726604462,
      "pose_mae_dx": 0.03736986592411995,
      "pose_mae_dy": 0.04176997393369675,
      "pose_rmse_dtheta": 0.21225206553936005,
      "pose_rmse_dx": 0.09446579962968826,
      "pose_rmse_dy": 0.09111066907644272,
      "pose_rmse_mean": 0.1326095163822174,
      "rmse_dtheta": 0.02752707153558731,
      "rmse_dx": 0.009845168329775333,
      "rmse_dy": 0.009900282137095928,
      "rmse_mean": 0.01575750857591629,
      "rotation_flip": 0.011545623652637005,
      "sparse_tokens": 32089.0,
      "step": 11246,
      "turn_loss": 0.13515962660312653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5225329864337483,
      "grad_norm": 0.3469739258289337,
      "learning_rate": 9.906271971131143e-08,
      "loss": 0.0772,
      "mae_dtheta": 0.009262604638934135,
      "mae_dx": 0.002034791512414813,
      "mae_dy": 0.0019166013225913048,
      "pose_mae_dtheta": 0.062191009521484375,
      "pose_mae_dx": 0.019618995487689972,
      "pose_mae_dy": 0.020767582580447197,
      "pose_rmse_dtheta": 0.1544802188873291,
      "pose_rmse_dx": 0.04539911076426506,
      "pose_rmse_dy": 0.06088678538799286,
      "pose_rmse_mean": 0.0869220420718193,
      "rmse_dtheta": 0.020442334935069084,
      "rmse_dx": 0.005653674714267254,
      "rmse_dy": 0.0045736245810985565,
      "rmse_mean": 0.010223211720585823,
      "rotation_flip": 0.004656577482819557,
      "sparse_tokens": 32153.0,
      "step": 11247,
      "turn_loss": 0.08841441571712494,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.5225794461995912,
      "grad_norm": 0.6697666645050049,
      "learning_rate": 9.88009963765496e-08,
      "loss": 0.1057,
      "mae_dtheta": 0.03391839936375618,
      "mae_dx": 0.016096606850624084,
      "mae_dy": 0.004264349117875099,
      "pose_mae_dtheta": 0.2619677186012268,
      "pose_mae_dx": 0.11858729273080826,
      "pose_mae_dy": 0.0485638827085495,
      "pose_rmse_dtheta": 0.43296557664871216,
      "pose_rmse_dx": 0.25339648127555847,
      "pose_rmse_dy": 0.1402316838502884,
      "pose_rmse_mean": 0.27553123235702515,
      "rmse_dtheta": 0.050441399216651917,
      "rmse_dx": 0.028988121077418327,
      "rmse_dy": 0.009142827242612839,
      "rmse_mean": 0.029524117708206177,
      "rotation_flip": 0.016643550246953964,
      "sparse_tokens": 11039.0,
      "step": 11248,
      "turn_loss": 0.3588770925998688,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5226259059654339,
      "grad_norm": 0.4205750823020935,
      "learning_rate": 9.853961578526417e-08,
      "loss": 0.0841,
      "mae_dtheta": 0.00705341063439846,
      "mae_dx": 0.0011347158579155803,
      "mae_dy": 0.0011040756944566965,
      "pose_mae_dtheta": 0.048857539892196655,
      "pose_mae_dx": 0.010186489671468735,
      "pose_mae_dy": 0.013233917765319347,
      "pose_rmse_dtheta": 0.18186943233013153,
      "pose_rmse_dx": 0.029959844425320625,
      "pose_rmse_dy": 0.03961353003978729,
      "pose_rmse_mean": 0.08381426334381104,
      "rmse_dtheta": 0.0221338402479887,
      "rmse_dx": 0.004140914883464575,
      "rmse_dy": 0.0034227133728563786,
      "rmse_mean": 0.009899156168103218,
      "rotation_flip": 0.002297530183568597,
      "sparse_tokens": 32121.0,
      "step": 11249,
      "turn_loss": 0.05402752384543419,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.5226723657312767,
      "grad_norm": 0.5935060977935791,
      "learning_rate": 9.827857795573437e-08,
      "loss": 0.1876,
      "mae_dtheta": 0.03978506103157997,
      "mae_dx": 0.011140064336359501,
      "mae_dy": 0.009653492830693722,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5935061573982239,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 137.69154357910156,
      "model/head/act_norm_mean": 99.51905014935662,
      "model/head/act_norm_min": 69.26359558105469,
      "model/head/act_over_embed": 68.39042297466473,
      "model/head/grad_frac": 0.11708065867424011,
      "model/head/grad_norm": 0.06948809325695038,
      "model/head/grad_zero_frac": 0.00019226668518967927,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6954848345588235,
      "model/head/update_ratio": 0.001182882464490831,
      "model/head/weight_delta": 9.984195709228516,
      "model/head/weight_delta_rel": 0.17515236139297485,
      "model/head/weight_norm": 58.74471664428711,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42291855812072754,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42286270686558314,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228227734565735,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059521106106395,
      "model/modality_embedder.encoders.pose/grad_frac": 0.07949727773666382,
      "model/modality_embedder.encoders.pose/grad_norm": 0.047182124108076096,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5404575892857143,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015234856400638819,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1566109657287598,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313631594181061,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969850540161133,
      "model/modality_embedder/grad_frac": 0.07949727773666382,
      "model/modality_embedder/grad_norm": 0.047182124108076096,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5404575892857143,
      "model/modality_embedder/update_ratio": 0.0015234856400638819,
      "model/modality_embedder/weight_delta": 3.1566109657287598,
      "model/modality_embedder/weight_delta_rel": 0.10313631594181061,
      "model/modality_embedder/weight_norm": 30.969850540161133,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 69.35133361816406,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.769939746732025,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.327125549316406,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.64771576948879,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07286030799150467,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04324303939938545,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015465457690879703,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7418272495269775,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09991384297609329,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961048126220703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 70.17200469970703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.527157738095237,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.567212104797363,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.16808306234012,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07244610786437988,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04299721121788025,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0014442846877500415,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.476292610168457,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12042149156332016,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770591735839844,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 71.66081237792969,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.187540120214752,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.242528915405273,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.30911338007742,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0686255395412445,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04072967916727066,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0013248797040432692,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7661261558532715,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12645946443080902,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742172241210938,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 71.64007568359375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.188240400326798,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.199597358703613,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.68401334342155,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0685330331325531,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04067477583885193,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013578410726040602,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2373292446136475,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11063654720783234,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955476760864258,
      "model/normalizer/grad_frac": 0.28110456466674805,
      "model/normalizer/grad_norm": 0.16683728992938995,
      "model/normalizer/grad_zero_frac": 0.00023398420307785273,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00212105386890471,
      "model/normalizer/weight_delta": 6.808096408843994,
      "model/normalizer/weight_delta_rel": 0.08768434077501297,
      "model/normalizer/weight_norm": 78.65773010253906,
      "pose_mae_dtheta": 0.32473739981651306,
      "pose_mae_dx": 0.11070264875888824,
      "pose_mae_dy": 0.09429506957530975,
      "pose_rmse_dtheta": 0.49554112553596497,
      "pose_rmse_dx": 0.22976964712142944,
      "pose_rmse_dy": 0.2150772660970688,
      "pose_rmse_mean": 0.3134627044200897,
      "rmse_dtheta": 0.056304045021533966,
      "rmse_dx": 0.02254932001233101,
      "rmse_dy": 0.018455209210515022,
      "rmse_mean": 0.03243619203567505,
      "rotation_flip": 0.014059754088521004,
      "sparse_tokens": 9181.0,
      "step": 11250,
      "turn_loss": 0.35295531153678894,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5227188254971195,
      "grad_norm": 0.9077606797218323,
      "learning_rate": 9.801788290621505e-08,
      "loss": 0.1485,
      "mae_dtheta": 0.010554972104728222,
      "mae_dx": 0.0016239099204540253,
      "mae_dy": 0.0026981541886925697,
      "pose_mae_dtheta": 0.0695917010307312,
      "pose_mae_dx": 0.021888338029384613,
      "pose_mae_dy": 0.027279777452349663,
      "pose_rmse_dtheta": 0.20360185205936432,
      "pose_rmse_dx": 0.05977185443043709,
      "pose_rmse_dy": 0.06545602530241013,
      "pose_rmse_mean": 0.10960991680622101,
      "rmse_dtheta": 0.025260772556066513,
      "rmse_dx": 0.00528488215059042,
      "rmse_dy": 0.006648452486842871,
      "rmse_mean": 0.012398036196827888,
      "rotation_flip": 0.008965259417891502,
      "sparse_tokens": 32089.0,
      "step": 11251,
      "turn_loss": 0.09646660089492798,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22718.0,
      "epoch": 0.5227652852629623,
      "grad_norm": 0.6745505332946777,
      "learning_rate": 9.775753065493555e-08,
      "loss": 0.1377,
      "mae_dtheta": 0.02395060658454895,
      "mae_dx": 0.009636258706450462,
      "mae_dy": 0.007320569362491369,
      "pose_mae_dtheta": 0.17098172008991241,
      "pose_mae_dx": 0.06888996064662933,
      "pose_mae_dy": 0.09957209974527359,
      "pose_rmse_dtheta": 0.30554434657096863,
      "pose_rmse_dx": 0.15497367084026337,
      "pose_rmse_dy": 0.21870258450508118,
      "pose_rmse_mean": 0.22640685737133026,
      "rmse_dtheta": 0.038179270923137665,
      "rmse_dx": 0.021700672805309296,
      "rmse_dy": 0.014881974086165428,
      "rmse_mean": 0.024920640513300896,
      "rotation_flip": 0.011664899066090584,
      "sparse_tokens": 18811.0,
      "step": 11252,
      "turn_loss": 0.2408805787563324,
      "turns": 70.0,
      "turns_per_sample": 70.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.522811745028805,
      "grad_norm": 0.5894349813461304,
      "learning_rate": 9.749752122010347e-08,
      "loss": 0.0988,
      "mae_dtheta": 0.016084661707282066,
      "mae_dx": 0.0017010048031806946,
      "mae_dy": 0.00346126570366323,
      "pose_mae_dtheta": 0.10610572248697281,
      "pose_mae_dx": 0.031905706971883774,
      "pose_mae_dy": 0.04478258639574051,
      "pose_rmse_dtheta": 0.2389623075723648,
      "pose_rmse_dx": 0.08346928656101227,
      "pose_rmse_dy": 0.1038050651550293,
      "pose_rmse_mean": 0.14207889139652252,
      "rmse_dtheta": 0.028171811252832413,
      "rmse_dx": 0.005122185684740543,
      "rmse_dy": 0.00672408752143383,
      "rmse_mean": 0.013339361175894737,
      "rotation_flip": 0.006285147275775671,
      "sparse_tokens": 32057.0,
      "step": 11253,
      "turn_loss": 0.10768748074769974,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.5228582047946478,
      "grad_norm": 0.36708998680114746,
      "learning_rate": 9.723785461990098e-08,
      "loss": 0.0913,
      "mae_dtheta": 0.03409821167588234,
      "mae_dx": 0.007861297577619553,
      "mae_dy": 0.005278453230857849,
      "pose_mae_dtheta": 0.27793899178504944,
      "pose_mae_dx": 0.06678002327680588,
      "pose_mae_dy": 0.05874228477478027,
      "pose_rmse_dtheta": 0.4511485695838928,
      "pose_rmse_dx": 0.1537499576807022,
      "pose_rmse_dy": 0.13011103868484497,
      "pose_rmse_mean": 0.24500319361686707,
      "rmse_dtheta": 0.048026248812675476,
      "rmse_dx": 0.018157145008444786,
      "rmse_dy": 0.0095409220084548,
      "rmse_mean": 0.025241440162062645,
      "rotation_flip": 0.008833922445774078,
      "sparse_tokens": 8793.0,
      "step": 11254,
      "turn_loss": 0.23121504485607147,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.5229046645604906,
      "grad_norm": 0.4264429211616516,
      "learning_rate": 9.697853087248687e-08,
      "loss": 0.1392,
      "mae_dtheta": 0.0371074341237545,
      "mae_dx": 0.011623659171164036,
      "mae_dy": 0.007652063388377428,
      "pose_mae_dtheta": 0.29841354489326477,
      "pose_mae_dx": 0.10457485914230347,
      "pose_mae_dy": 0.11478439718484879,
      "pose_rmse_dtheta": 0.4909849464893341,
      "pose_rmse_dx": 0.24521493911743164,
      "pose_rmse_dy": 0.23508988320827484,
      "pose_rmse_mean": 0.32376325130462646,
      "rmse_dtheta": 0.05211460962891579,
      "rmse_dx": 0.025242382660508156,
      "rmse_dy": 0.013794458471238613,
      "rmse_mean": 0.030383817851543427,
      "rotation_flip": 0.01808066852390766,
      "sparse_tokens": 13398.0,
      "step": 11255,
      "turn_loss": 0.2503218948841095,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5229511243263334,
      "grad_norm": 0.3855293393135071,
      "learning_rate": 9.671954999599554e-08,
      "loss": 0.0831,
      "mae_dtheta": 0.007923186756670475,
      "mae_dx": 0.0015337674412876368,
      "mae_dy": 0.0007963153184391558,
      "pose_mae_dtheta": 0.05727296695113182,
      "pose_mae_dx": 0.011974816210567951,
      "pose_mae_dy": 0.010447335429489613,
      "pose_rmse_dtheta": 0.21836014091968536,
      "pose_rmse_dx": 0.03136570006608963,
      "pose_rmse_dy": 0.0385996475815773,
      "pose_rmse_mean": 0.09610849618911743,
      "rmse_dtheta": 0.025916537269949913,
      "rmse_dx": 0.005046783480793238,
      "rmse_dy": 0.003266455139964819,
      "rmse_mean": 0.011409925296902657,
      "rotation_flip": 0.0037960954941809177,
      "sparse_tokens": 32185.0,
      "step": 11256,
      "turn_loss": 0.05180962011218071,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5229975840921762,
      "grad_norm": 0.5558667778968811,
      "learning_rate": 9.646091200853802e-08,
      "loss": 0.1078,
      "mae_dtheta": 0.008524201810359955,
      "mae_dx": 0.0020460353698581457,
      "mae_dy": 0.001584431272931397,
      "pose_mae_dtheta": 0.056333307176828384,
      "pose_mae_dx": 0.02221168391406536,
      "pose_mae_dy": 0.02085690386593342,
      "pose_rmse_dtheta": 0.1758870780467987,
      "pose_rmse_dx": 0.08702688664197922,
      "pose_rmse_dy": 0.06410564482212067,
      "pose_rmse_mean": 0.10900654643774033,
      "rmse_dtheta": 0.022200480103492737,
      "rmse_dx": 0.008295485749840736,
      "rmse_dy": 0.004303074441850185,
      "rmse_mean": 0.011599680408835411,
      "rotation_flip": 0.0044356826692819595,
      "sparse_tokens": 32089.0,
      "step": 11257,
      "turn_loss": 0.0886094868183136,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.523044043858019,
      "grad_norm": 0.5829574465751648,
      "learning_rate": 9.620261692820099e-08,
      "loss": 0.1021,
      "mae_dtheta": 0.01079404354095459,
      "mae_dx": 0.0019253010395914316,
      "mae_dy": 0.002520886017009616,
      "pose_mae_dtheta": 0.08128437399864197,
      "pose_mae_dx": 0.018036307767033577,
      "pose_mae_dy": 0.024437522515654564,
      "pose_rmse_dtheta": 0.23944243788719177,
      "pose_rmse_dx": 0.05071932077407837,
      "pose_rmse_dy": 0.07148360460996628,
      "pose_rmse_mean": 0.12054845690727234,
      "rmse_dtheta": 0.02675648219883442,
      "rmse_dx": 0.0065505169332027435,
      "rmse_dy": 0.006989846937358379,
      "rmse_mean": 0.013432282954454422,
      "rotation_flip": 0.003253796137869358,
      "sparse_tokens": 32153.0,
      "step": 11258,
      "turn_loss": 0.09849489480257034,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5230905036238618,
      "grad_norm": 0.45445314049720764,
      "learning_rate": 9.594466477304665e-08,
      "loss": 0.1258,
      "mae_dtheta": 0.012906151823699474,
      "mae_dx": 0.003590421983972192,
      "mae_dy": 0.004943844396620989,
      "pose_mae_dtheta": 0.09040215611457825,
      "pose_mae_dx": 0.04053136333823204,
      "pose_mae_dy": 0.03743709996342659,
      "pose_rmse_dtheta": 0.2025691717863083,
      "pose_rmse_dx": 0.10674180090427399,
      "pose_rmse_dy": 0.11145088076591492,
      "pose_rmse_mean": 0.1402539610862732,
      "rmse_dtheta": 0.026391256600618362,
      "rmse_dx": 0.008852649480104446,
      "rmse_dy": 0.011302018538117409,
      "rmse_mean": 0.015515307895839214,
      "rotation_flip": 0.004462862387299538,
      "sparse_tokens": 32153.0,
      "step": 11259,
      "turn_loss": 0.14866991341114044,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5231369633897045,
      "grad_norm": 0.5270020365715027,
      "learning_rate": 9.568705556111391e-08,
      "loss": 0.118,
      "mae_dtheta": 0.007211115676909685,
      "mae_dx": 0.000869138864800334,
      "mae_dy": 0.0014487903099507093,
      "pose_mae_dtheta": 0.047639694064855576,
      "pose_mae_dx": 0.012671301141381264,
      "pose_mae_dy": 0.019292477518320084,
      "pose_rmse_dtheta": 0.14386852085590363,
      "pose_rmse_dx": 0.03680810704827309,
      "pose_rmse_dy": 0.055480629205703735,
      "pose_rmse_mean": 0.07871908694505692,
      "rmse_dtheta": 0.01952376775443554,
      "rmse_dx": 0.0030266668181866407,
      "rmse_dy": 0.0033881680574268103,
      "rmse_mean": 0.008646201342344284,
      "rotation_flip": 0.0034860558807849884,
      "sparse_tokens": 32041.0,
      "step": 11260,
      "turn_loss": 0.05084407329559326,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.5231834231555473,
      "grad_norm": 0.7041187286376953,
      "learning_rate": 9.542978931041835e-08,
      "loss": 0.1776,
      "mae_dtheta": 0.027364859357476234,
      "mae_dx": 0.009071427397429943,
      "mae_dy": 0.008444031700491905,
      "pose_mae_dtheta": 0.1919035166501999,
      "pose_mae_dx": 0.08310867846012115,
      "pose_mae_dy": 0.1269100457429886,
      "pose_rmse_dtheta": 0.2730909585952759,
      "pose_rmse_dx": 0.17898595333099365,
      "pose_rmse_dy": 0.19682852923870087,
      "pose_rmse_mean": 0.216301828622818,
      "rmse_dtheta": 0.03765855357050896,
      "rmse_dx": 0.021614128723740578,
      "rmse_dy": 0.010935280472040176,
      "rmse_mean": 0.023402657359838486,
      "rotation_flip": 0.006849315017461777,
      "sparse_tokens": 2656.0,
      "step": 11261,
      "turn_loss": 0.2439056634902954,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.52322988292139,
      "grad_norm": 0.5677558779716492,
      "learning_rate": 9.517286603894949e-08,
      "loss": 0.1012,
      "mae_dtheta": 0.007368306629359722,
      "mae_dx": 0.0010908200638368726,
      "mae_dy": 0.0015918761491775513,
      "pose_mae_dtheta": 0.053436119109392166,
      "pose_mae_dx": 0.01594771258533001,
      "pose_mae_dy": 0.020510094240307808,
      "pose_rmse_dtheta": 0.17872582376003265,
      "pose_rmse_dx": 0.04816265404224396,
      "pose_rmse_dy": 0.05544121935963631,
      "pose_rmse_mean": 0.094109907746315,
      "rmse_dtheta": 0.01994721218943596,
      "rmse_dx": 0.004061602521687746,
      "rmse_dy": 0.004226692020893097,
      "rmse_mean": 0.009411836043000221,
      "rotation_flip": 0.002087682718411088,
      "sparse_tokens": 32041.0,
      "step": 11262,
      "turn_loss": 0.05695869028568268,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 35688.0,
      "epoch": 0.5232763426872329,
      "grad_norm": 0.28951385617256165,
      "learning_rate": 9.491628576467516e-08,
      "loss": 0.0851,
      "mae_dtheta": 0.021020539104938507,
      "mae_dx": 0.007400463335216045,
      "mae_dy": 0.0041096932254731655,
      "pose_mae_dtheta": 0.16108554601669312,
      "pose_mae_dx": 0.06779909133911133,
      "pose_mae_dy": 0.05273349955677986,
      "pose_rmse_dtheta": 0.3294738233089447,
      "pose_rmse_dx": 0.18114721775054932,
      "pose_rmse_dy": 0.13584142923355103,
      "pose_rmse_mean": 0.2154875099658966,
      "rmse_dtheta": 0.037139762192964554,
      "rmse_dx": 0.018979040905833244,
      "rmse_dy": 0.008242684416472912,
      "rmse_mean": 0.021453827619552612,
      "rotation_flip": 0.010463378392159939,
      "sparse_tokens": 27750.0,
      "step": 11263,
      "turn_loss": 0.17774365842342377,
      "turns": 110.0,
      "turns_per_sample": 110.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.5233228024530756,
      "grad_norm": 0.5796496272087097,
      "learning_rate": 9.466004850553711e-08,
      "loss": 0.1354,
      "mae_dtheta": 0.01927425153553486,
      "mae_dx": 0.003884746925905347,
      "mae_dy": 0.004347991198301315,
      "pose_mae_dtheta": 0.12777897715568542,
      "pose_mae_dx": 0.031636275351047516,
      "pose_mae_dy": 0.06498483568429947,
      "pose_rmse_dtheta": 0.25486257672309875,
      "pose_rmse_dx": 0.07556185871362686,
      "pose_rmse_dy": 0.1589457243680954,
      "pose_rmse_mean": 0.16312339901924133,
      "rmse_dtheta": 0.03354017063975334,
      "rmse_dx": 0.01150276605039835,
      "rmse_dy": 0.008462682366371155,
      "rmse_mean": 0.017835207283496857,
      "rotation_flip": 0.015256588347256184,
      "sparse_tokens": 15434.0,
      "step": 11264,
      "turn_loss": 0.1541571170091629,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.5233692622189184,
      "grad_norm": 0.49476948380470276,
      "learning_rate": 9.440415427945548e-08,
      "loss": 0.1375,
      "mae_dtheta": 0.028469610959291458,
      "mae_dx": 0.009715908206999302,
      "mae_dy": 0.0036581058520823717,
      "pose_mae_dtheta": 0.22352193295955658,
      "pose_mae_dx": 0.07542448490858078,
      "pose_mae_dy": 0.048369307070970535,
      "pose_rmse_dtheta": 0.35428446531295776,
      "pose_rmse_dx": 0.2066071629524231,
      "pose_rmse_dy": 0.10453790426254272,
      "pose_rmse_mean": 0.22180984914302826,
      "rmse_dtheta": 0.040848508477211,
      "rmse_dx": 0.021932393312454224,
      "rmse_dy": 0.005995674524456263,
      "rmse_mean": 0.022925525903701782,
      "rotation_flip": 0.014344261959195137,
      "sparse_tokens": 8162.0,
      "step": 11265,
      "turn_loss": 0.21652548015117645,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 3278.0,
      "epoch": 0.5234157219847612,
      "grad_norm": 0.38175636529922485,
      "learning_rate": 9.414860310432317e-08,
      "loss": 0.077,
      "mae_dtheta": 0.024286877363920212,
      "mae_dx": 0.012960139662027359,
      "mae_dy": 0.006589644588530064,
      "pose_mae_dtheta": 0.1387566775083542,
      "pose_mae_dx": 0.09250947088003159,
      "pose_mae_dy": 0.08056284487247467,
      "pose_rmse_dtheta": 0.20564299821853638,
      "pose_rmse_dx": 0.22843030095100403,
      "pose_rmse_dy": 0.1382942944765091,
      "pose_rmse_mean": 0.19078920781612396,
      "rmse_dtheta": 0.03175337612628937,
      "rmse_dx": 0.025503087788820267,
      "rmse_dy": 0.009889177046716213,
      "rmse_mean": 0.02238187938928604,
      "rotation_flip": 0.006849315017461777,
      "sparse_tokens": 2649.0,
      "step": 11266,
      "turn_loss": 0.25460609793663025,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 39263.0,
      "epoch": 0.523462181750604,
      "grad_norm": 0.502803385257721,
      "learning_rate": 9.389339499801308e-08,
      "loss": 0.121,
      "mae_dtheta": 0.036423858255147934,
      "mae_dx": 0.013260028325021267,
      "mae_dy": 0.004385549575090408,
      "pose_mae_dtheta": 0.27485477924346924,
      "pose_mae_dx": 0.10227763652801514,
      "pose_mae_dy": 0.041803449392318726,
      "pose_rmse_dtheta": 0.49794596433639526,
      "pose_rmse_dx": 0.23248840868473053,
      "pose_rmse_dy": 0.12075451761484146,
      "pose_rmse_mean": 0.2837296426296234,
      "rmse_dtheta": 0.05698457360267639,
      "rmse_dx": 0.026425009593367577,
      "rmse_dy": 0.010640468448400497,
      "rmse_mean": 0.031350016593933105,
      "rotation_flip": 0.0172955971211195,
      "sparse_tokens": 29297.0,
      "step": 11267,
      "turn_loss": 0.28654375672340393,
      "turns": 121.0,
      "turns_per_sample": 121.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.5235086415164467,
      "grad_norm": 0.40758341550827026,
      "learning_rate": 9.363852997837097e-08,
      "loss": 0.1063,
      "mae_dtheta": 0.026753636077046394,
      "mae_dx": 0.010476824827492237,
      "mae_dy": 0.004489824175834656,
      "pose_mae_dtheta": 0.17600037157535553,
      "pose_mae_dx": 0.0803949162364006,
      "pose_mae_dy": 0.06035790592432022,
      "pose_rmse_dtheta": 0.33660420775413513,
      "pose_rmse_dx": 0.2014784812927246,
      "pose_rmse_dy": 0.14101509749889374,
      "pose_rmse_mean": 0.22636595368385315,
      "rmse_dtheta": 0.044219642877578735,
      "rmse_dx": 0.023875856772065163,
      "rmse_dy": 0.009665695019066334,
      "rmse_mean": 0.02592039853334427,
      "rotation_flip": 0.005455962382256985,
      "sparse_tokens": 23483.0,
      "step": 11268,
      "turn_loss": 0.22361789643764496,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5235551012822895,
      "grad_norm": 0.5976209044456482,
      "learning_rate": 9.338400806321979e-08,
      "loss": 0.0881,
      "mae_dtheta": 0.007480100728571415,
      "mae_dx": 0.0014550131745636463,
      "mae_dy": 0.0021344581618905067,
      "pose_mae_dtheta": 0.04911411181092262,
      "pose_mae_dx": 0.018630169332027435,
      "pose_mae_dy": 0.01953612081706524,
      "pose_rmse_dtheta": 0.118161141872406,
      "pose_rmse_dx": 0.05749727785587311,
      "pose_rmse_dy": 0.047729749232530594,
      "pose_rmse_mean": 0.07446272671222687,
      "rmse_dtheta": 0.01750839129090309,
      "rmse_dx": 0.004637861158698797,
      "rmse_dy": 0.005386439152061939,
      "rmse_mean": 0.009177564643323421,
      "rotation_flip": 0.0025868441443890333,
      "sparse_tokens": 32121.0,
      "step": 11269,
      "turn_loss": 0.08300967514514923,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.5236015610481323,
      "grad_norm": 0.5518838763237,
      "learning_rate": 9.312982927035863e-08,
      "loss": 0.1127,
      "mae_dtheta": 0.03483990579843521,
      "mae_dx": 0.009548845700919628,
      "mae_dy": 0.008017848245799541,
      "pose_mae_dtheta": 0.2738143503665924,
      "pose_mae_dx": 0.0803522989153862,
      "pose_mae_dy": 0.1121688187122345,
      "pose_rmse_dtheta": 0.45698878169059753,
      "pose_rmse_dx": 0.18516886234283447,
      "pose_rmse_dy": 0.2613377571105957,
      "pose_rmse_mean": 0.3011651635169983,
      "rmse_dtheta": 0.051467955112457275,
      "rmse_dx": 0.0222112238407135,
      "rmse_dy": 0.014707524329423904,
      "rmse_mean": 0.029462233185768127,
      "rotation_flip": 0.024096384644508362,
      "sparse_tokens": 4715.0,
      "step": 11270,
      "turn_loss": 0.3209320902824402,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.5236480208139751,
      "grad_norm": 0.4134059548377991,
      "learning_rate": 9.287599361756217e-08,
      "loss": 0.0682,
      "mae_dtheta": 0.023853031918406487,
      "mae_dx": 0.0037593264132738113,
      "mae_dy": 0.0034234211780130863,
      "pose_mae_dtheta": 0.1855524629354477,
      "pose_mae_dx": 0.03405863419175148,
      "pose_mae_dy": 0.03315398097038269,
      "pose_rmse_dtheta": 0.35870638489723206,
      "pose_rmse_dx": 0.07930371910333633,
      "pose_rmse_dy": 0.07920780032873154,
      "pose_rmse_mean": 0.17240595817565918,
      "rmse_dtheta": 0.0413946807384491,
      "rmse_dx": 0.00955433864146471,
      "rmse_dy": 0.008633771911263466,
      "rmse_mean": 0.019860930740833282,
      "rotation_flip": 0.0044247787445783615,
      "sparse_tokens": 6582.0,
      "step": 11271,
      "turn_loss": 0.14159958064556122,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5236944805798178,
      "grad_norm": 0.5303915739059448,
      "learning_rate": 9.26225011225812e-08,
      "loss": 0.0954,
      "mae_dtheta": 0.0069421036168932915,
      "mae_dx": 0.0008765984093770385,
      "mae_dy": 0.0015164908254519105,
      "pose_mae_dtheta": 0.05164853110909462,
      "pose_mae_dx": 0.011721416376531124,
      "pose_mae_dy": 0.025409050285816193,
      "pose_rmse_dtheta": 0.13232509791851044,
      "pose_rmse_dx": 0.0293717198073864,
      "pose_rmse_dy": 0.08595976233482361,
      "pose_rmse_mean": 0.08255219459533691,
      "rmse_dtheta": 0.01673249900341034,
      "rmse_dx": 0.002371095586568117,
      "rmse_dy": 0.003673178143799305,
      "rmse_mean": 0.007592257112264633,
      "rotation_flip": 0.003759398590773344,
      "sparse_tokens": 32105.0,
      "step": 11272,
      "turn_loss": 0.053273994475603104,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5237409403456607,
      "grad_norm": 0.48981809616088867,
      "learning_rate": 9.236935180314267e-08,
      "loss": 0.1159,
      "mae_dtheta": 0.006045009009540081,
      "mae_dx": 0.0011468209559097886,
      "mae_dy": 0.0011444154661148787,
      "pose_mae_dtheta": 0.03999986872076988,
      "pose_mae_dx": 0.013205482624471188,
      "pose_mae_dy": 0.015796754509210587,
      "pose_rmse_dtheta": 0.0847034826874733,
      "pose_rmse_dx": 0.030762113630771637,
      "pose_rmse_dy": 0.04028746485710144,
      "pose_rmse_mean": 0.05191768705844879,
      "rmse_dtheta": 0.013977252878248692,
      "rmse_dx": 0.0032571025658398867,
      "rmse_dy": 0.002687909873202443,
      "rmse_mean": 0.006640755571424961,
      "rotation_flip": 0.0020964359864592552,
      "sparse_tokens": 32169.0,
      "step": 11273,
      "turn_loss": 0.05069096013903618,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.5237874001115035,
      "grad_norm": 0.9650636911392212,
      "learning_rate": 9.211654567694961e-08,
      "loss": 0.286,
      "mae_dtheta": 0.0351063534617424,
      "mae_dx": 0.01489187404513359,
      "mae_dy": 0.008970038965344429,
      "pose_mae_dtheta": 0.2890065312385559,
      "pose_mae_dx": 0.11748521775007248,
      "pose_mae_dy": 0.1062818169593811,
      "pose_rmse_dtheta": 0.4477125108242035,
      "pose_rmse_dx": 0.2464706152677536,
      "pose_rmse_dy": 0.24051880836486816,
      "pose_rmse_mean": 0.3115673065185547,
      "rmse_dtheta": 0.04805067181587219,
      "rmse_dx": 0.0282151997089386,
      "rmse_dy": 0.01888536661863327,
      "rmse_mean": 0.03171708062291145,
      "rotation_flip": 0.013171225786209106,
      "sparse_tokens": 15400.0,
      "step": 11274,
      "turn_loss": 0.34927085041999817,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5238338598773462,
      "grad_norm": 0.261495977640152,
      "learning_rate": 9.186408276168012e-08,
      "loss": 0.0525,
      "mae_dtheta": 0.006806624587625265,
      "mae_dx": 0.000990013126283884,
      "mae_dy": 0.0011599368881434202,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.261495977640152,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 158.85581970214844,
      "model/head/act_norm_mean": 115.69323113952021,
      "model/head/act_norm_min": 60.63083267211914,
      "model/head/act_over_embed": 79.50547157617332,
      "model/head/grad_frac": 0.10438350588083267,
      "model/head/grad_norm": 0.02729586698114872,
      "model/head/grad_zero_frac": 0.00018655580061022192,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6978574810606061,
      "model/head/update_ratio": 0.000464652111986652,
      "model/head/weight_delta": 9.984395027160645,
      "model/head/weight_delta_rel": 0.1751558631658554,
      "model/head/weight_norm": 58.7447395324707,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229392409324646,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228660001883058,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227903187274933,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059747426327154,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08335518836975098,
      "model/modality_embedder.encoders.pose/grad_norm": 0.021797046065330505,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.541120725896861,
      "model/modality_embedder.encoders.pose/update_ratio": 0.000703815370798111,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1564879417419434,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313230007886887,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96983528137207,
      "model/modality_embedder/grad_frac": 0.08335518836975098,
      "model/modality_embedder/grad_norm": 0.021797046065330505,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.541120725896861,
      "model/modality_embedder/update_ratio": 0.000703815370798111,
      "model/modality_embedder/weight_delta": 3.1564879417419434,
      "model/modality_embedder/weight_delta_rel": 0.10313230007886887,
      "model/modality_embedder/weight_norm": 30.96983528137207,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 84.2238540649414,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.1695351330768,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.944164276123047,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.60953082220337,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.072088323533535,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.01885080710053444,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.00067418027902022,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.741940975189209,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09991798549890518,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961078643798828,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 84.78681182861328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.16442199775533,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.111241340637207,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.293226389888034,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06866103410720825,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.01795458421111107,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0006030971999280155,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4764211177825928,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12042594701051712,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770631790161133,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.84244537353516,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.01978866041366,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 11.944382667541504,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.568251730683208,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06795232743024826,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.017769260331988335,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0005780083010904491,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.766287326812744,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1264648735523224,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742223739624023,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 85.48485565185547,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.677343875260544,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.480829238891602,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.7073391926024,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06682498008012772,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.01747446320950985,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0005833470495417714,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.237466812133789,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.110641248524189,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955516815185547,
      "model/normalizer/grad_frac": 0.22176523506641388,
      "model/normalizer/grad_norm": 0.05799071863293648,
      "model/normalizer/grad_zero_frac": 0.00019262336718384176,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0007372532854788005,
      "model/normalizer/weight_delta": 6.80837345123291,
      "model/normalizer/weight_delta_rel": 0.0876879096031189,
      "model/normalizer/weight_norm": 78.65779876708984,
      "pose_mae_dtheta": 0.03787178918719292,
      "pose_mae_dx": 0.011863544583320618,
      "pose_mae_dy": 0.015020908787846565,
      "pose_rmse_dtheta": 0.09584503620862961,
      "pose_rmse_dx": 0.029968274757266045,
      "pose_rmse_dy": 0.03373425453901291,
      "pose_rmse_mean": 0.05318252369761467,
      "rmse_dtheta": 0.015700720250606537,
      "rmse_dx": 0.0033040782436728477,
      "rmse_dy": 0.0025702277198433876,
      "rmse_mean": 0.007191675715148449,
      "rotation_flip": 0.0008478168747387826,
      "sparse_tokens": 32105.0,
      "step": 11275,
      "turn_loss": 0.05486535653471947,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.523880319643189,
      "grad_norm": 0.33101826906204224,
      "learning_rate": 9.16119630749901e-08,
      "loss": 0.0668,
      "mae_dtheta": 0.0455581471323967,
      "mae_dx": 0.008875350467860699,
      "mae_dy": 0.0038574247155338526,
      "pose_mae_dtheta": 0.3922925889492035,
      "pose_mae_dx": 0.0772525891661644,
      "pose_mae_dy": 0.04971272498369217,
      "pose_rmse_dtheta": 0.6303361058235168,
      "pose_rmse_dx": 0.1733466386795044,
      "pose_rmse_dy": 0.1741398721933365,
      "pose_rmse_mean": 0.325940877199173,
      "rmse_dtheta": 0.06478530168533325,
      "rmse_dx": 0.018886569887399673,
      "rmse_dy": 0.009907528758049011,
      "rmse_mean": 0.03119313344359398,
      "rotation_flip": 0.017173051834106445,
      "sparse_tokens": 12632.0,
      "step": 11276,
      "turn_loss": 0.3379378914833069,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5239267794090318,
      "grad_norm": 0.501960813999176,
      "learning_rate": 9.13601866345104e-08,
      "loss": 0.1244,
      "mae_dtheta": 0.007519787177443504,
      "mae_dx": 0.001262473058886826,
      "mae_dy": 0.0019141421653330326,
      "pose_mae_dtheta": 0.04820394888520241,
      "pose_mae_dx": 0.01724068634212017,
      "pose_mae_dy": 0.020081626251339912,
      "pose_rmse_dtheta": 0.1145043671131134,
      "pose_rmse_dx": 0.05673765391111374,
      "pose_rmse_dy": 0.05415446683764458,
      "pose_rmse_mean": 0.07513216882944107,
      "rmse_dtheta": 0.017817005515098572,
      "rmse_dx": 0.003502677194774151,
      "rmse_dy": 0.005685099400579929,
      "rmse_mean": 0.00900159403681755,
      "rotation_flip": 0.004014598671346903,
      "sparse_tokens": 32169.0,
      "step": 11277,
      "turn_loss": 0.06960463523864746,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5239732391748746,
      "grad_norm": 0.489105224609375,
      "learning_rate": 9.110875345784697e-08,
      "loss": 0.1019,
      "mae_dtheta": 0.008180287666618824,
      "mae_dx": 0.0014703196939080954,
      "mae_dy": 0.0018015698296949267,
      "pose_mae_dtheta": 0.05553073436021805,
      "pose_mae_dx": 0.022354641929268837,
      "pose_mae_dy": 0.02394905500113964,
      "pose_rmse_dtheta": 0.1347898691892624,
      "pose_rmse_dx": 0.06658712774515152,
      "pose_rmse_dy": 0.06452693045139313,
      "pose_rmse_mean": 0.08863465487957001,
      "rmse_dtheta": 0.018572594970464706,
      "rmse_dx": 0.004763117991387844,
      "rmse_dy": 0.004723764024674892,
      "rmse_mean": 0.009353159926831722,
      "rotation_flip": 0.0014771048445254564,
      "sparse_tokens": 32073.0,
      "step": 11278,
      "turn_loss": 0.06927116215229034,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5240196989407173,
      "grad_norm": 0.6081960201263428,
      "learning_rate": 9.085766356258352e-08,
      "loss": 0.1387,
      "mae_dtheta": 0.014946824871003628,
      "mae_dx": 0.00436422461643815,
      "mae_dy": 0.006222192198038101,
      "pose_mae_dtheta": 0.09196429699659348,
      "pose_mae_dx": 0.05106450244784355,
      "pose_mae_dy": 0.04801939055323601,
      "pose_rmse_dtheta": 0.2201729267835617,
      "pose_rmse_dx": 0.14086702466011047,
      "pose_rmse_dy": 0.13557890057563782,
      "pose_rmse_mean": 0.16553962230682373,
      "rmse_dtheta": 0.02899198979139328,
      "rmse_dx": 0.012260189279913902,
      "rmse_dy": 0.014704554341733456,
      "rmse_mean": 0.01865224540233612,
      "rotation_flip": 0.011576135642826557,
      "sparse_tokens": 32089.0,
      "step": 11279,
      "turn_loss": 0.1637265384197235,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5240661587065601,
      "grad_norm": 0.4024401307106018,
      "learning_rate": 9.060691696627822e-08,
      "loss": 0.1383,
      "mae_dtheta": 0.011080450378358364,
      "mae_dx": 0.0016710148192942142,
      "mae_dy": 0.002647656947374344,
      "pose_mae_dtheta": 0.07410383969545364,
      "pose_mae_dx": 0.024010617285966873,
      "pose_mae_dy": 0.02997472696006298,
      "pose_rmse_dtheta": 0.1997860223054886,
      "pose_rmse_dx": 0.07479105144739151,
      "pose_rmse_dy": 0.07575208693742752,
      "pose_rmse_mean": 0.11677639186382294,
      "rmse_dtheta": 0.02530994825065136,
      "rmse_dx": 0.005661201663315296,
      "rmse_dy": 0.005576619878411293,
      "rmse_mean": 0.01218259148299694,
      "rotation_flip": 0.00737847201526165,
      "sparse_tokens": 32041.0,
      "step": 11280,
      "turn_loss": 0.10105734318494797,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5241126184724029,
      "grad_norm": 0.46719083189964294,
      "learning_rate": 9.035651368646647e-08,
      "loss": 0.1126,
      "mae_dtheta": 0.009320234879851341,
      "mae_dx": 0.002231047721579671,
      "mae_dy": 0.002150740008801222,
      "pose_mae_dtheta": 0.060869913548231125,
      "pose_mae_dx": 0.023928089067339897,
      "pose_mae_dy": 0.02442963980138302,
      "pose_rmse_dtheta": 0.15763980150222778,
      "pose_rmse_dx": 0.07297412306070328,
      "pose_rmse_dy": 0.07042869925498962,
      "pose_rmse_mean": 0.10034754127264023,
      "rmse_dtheta": 0.021116847172379494,
      "rmse_dx": 0.007691595237702131,
      "rmse_dy": 0.006227129139006138,
      "rmse_mean": 0.011678524315357208,
      "rotation_flip": 0.0074775670655071735,
      "sparse_tokens": 32073.0,
      "step": 11281,
      "turn_loss": 0.08163126558065414,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.5241590782382457,
      "grad_norm": 0.41312912106513977,
      "learning_rate": 9.010645374065874e-08,
      "loss": 0.0896,
      "mae_dtheta": 0.03789548575878143,
      "mae_dx": 0.007656558882445097,
      "mae_dy": 0.005251496564596891,
      "pose_mae_dtheta": 0.3128206729888916,
      "pose_mae_dx": 0.05137922987341881,
      "pose_mae_dy": 0.07037649303674698,
      "pose_rmse_dtheta": 0.5745980739593506,
      "pose_rmse_dx": 0.13263720273971558,
      "pose_rmse_dy": 0.14982269704341888,
      "pose_rmse_mean": 0.28568601608276367,
      "rmse_dtheta": 0.05765285715460777,
      "rmse_dx": 0.017208382487297058,
      "rmse_dy": 0.00962523277848959,
      "rmse_mean": 0.028162159025669098,
      "rotation_flip": 0.01034482754766941,
      "sparse_tokens": 5665.0,
      "step": 11282,
      "turn_loss": 0.2637993395328522,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5242055380040884,
      "grad_norm": 0.573465883731842,
      "learning_rate": 8.985673714634213e-08,
      "loss": 0.1648,
      "mae_dtheta": 0.005395174492150545,
      "mae_dx": 0.0008977753459475935,
      "mae_dy": 0.0010366329224780202,
      "pose_mae_dtheta": 0.03968314081430435,
      "pose_mae_dx": 0.010893013328313828,
      "pose_mae_dy": 0.013643085956573486,
      "pose_rmse_dtheta": 0.14757801592350006,
      "pose_rmse_dx": 0.03290630131959915,
      "pose_rmse_dy": 0.03788815066218376,
      "pose_rmse_mean": 0.07279083132743835,
      "rmse_dtheta": 0.016087841242551804,
      "rmse_dx": 0.003197965444996953,
      "rmse_dy": 0.0026459384243935347,
      "rmse_mean": 0.007310581859201193,
      "rotation_flip": 0.0040721348486840725,
      "sparse_tokens": 32057.0,
      "step": 11283,
      "turn_loss": 0.04261220991611481,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20128.0,
      "epoch": 0.5242519977699313,
      "grad_norm": 0.3625715970993042,
      "learning_rate": 8.960736392097936e-08,
      "loss": 0.0817,
      "mae_dtheta": 0.03191687539219856,
      "mae_dx": 0.011772162280976772,
      "mae_dy": 0.005348116159439087,
      "pose_mae_dtheta": 0.2128746211528778,
      "pose_mae_dx": 0.09809752553701401,
      "pose_mae_dy": 0.06442084908485413,
      "pose_rmse_dtheta": 0.3987324833869934,
      "pose_rmse_dx": 0.2589651644229889,
      "pose_rmse_dy": 0.16955746710300446,
      "pose_rmse_mean": 0.2757517099380493,
      "rmse_dtheta": 0.049818526953458786,
      "rmse_dx": 0.025947703048586845,
      "rmse_dy": 0.012362105771899223,
      "rmse_mean": 0.029376111924648285,
      "rotation_flip": 0.012731481343507767,
      "sparse_tokens": 16147.0,
      "step": 11284,
      "turn_loss": 0.2423013299703598,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.524298457535774,
      "grad_norm": 0.4642651677131653,
      "learning_rate": 8.935833408200922e-08,
      "loss": 0.118,
      "mae_dtheta": 0.009538724087178707,
      "mae_dx": 0.0011013421462848783,
      "mae_dy": 0.0009811215568333864,
      "pose_mae_dtheta": 0.05983041599392891,
      "pose_mae_dx": 0.011998728848993778,
      "pose_mae_dy": 0.010918294079601765,
      "pose_rmse_dtheta": 0.22458575665950775,
      "pose_rmse_dx": 0.030957022681832314,
      "pose_rmse_dy": 0.03169213607907295,
      "pose_rmse_mean": 0.09574498236179352,
      "rmse_dtheta": 0.027599740773439407,
      "rmse_dx": 0.003312952583655715,
      "rmse_dy": 0.002421703189611435,
      "rmse_mean": 0.011111466214060783,
      "rotation_flip": 0.0021030493080615997,
      "sparse_tokens": 32137.0,
      "step": 11285,
      "turn_loss": 0.05582975223660469,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5243449173016168,
      "grad_norm": 0.4300643801689148,
      "learning_rate": 8.910964764684671e-08,
      "loss": 0.097,
      "mae_dtheta": 0.010797803290188313,
      "mae_dx": 0.0018294580513611436,
      "mae_dy": 0.0025394316762685776,
      "pose_mae_dtheta": 0.06650208681821823,
      "pose_mae_dx": 0.026773037388920784,
      "pose_mae_dy": 0.027136605232954025,
      "pose_rmse_dtheta": 0.14019307494163513,
      "pose_rmse_dx": 0.08006992191076279,
      "pose_rmse_dy": 0.06113105267286301,
      "pose_rmse_mean": 0.09379802644252777,
      "rmse_dtheta": 0.02228250913321972,
      "rmse_dx": 0.006000503897666931,
      "rmse_dy": 0.005511268507689238,
      "rmse_mean": 0.011264760047197342,
      "rotation_flip": 0.0021528524812310934,
      "sparse_tokens": 32121.0,
      "step": 11286,
      "turn_loss": 0.09475474804639816,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5243913770674595,
      "grad_norm": 0.4167298972606659,
      "learning_rate": 8.886130463288178e-08,
      "loss": 0.1257,
      "mae_dtheta": 0.008077239617705345,
      "mae_dx": 0.0011296714656054974,
      "mae_dy": 0.001975888852030039,
      "pose_mae_dtheta": 0.04910586029291153,
      "pose_mae_dx": 0.015074060298502445,
      "pose_mae_dy": 0.022591937333345413,
      "pose_rmse_dtheta": 0.09376271069049835,
      "pose_rmse_dx": 0.03481338545680046,
      "pose_rmse_dy": 0.04547571763396263,
      "pose_rmse_mean": 0.05801727622747421,
      "rmse_dtheta": 0.015532869845628738,
      "rmse_dx": 0.0032501472160220146,
      "rmse_dy": 0.003750801784917712,
      "rmse_mean": 0.00751127302646637,
      "rotation_flip": 0.001986755058169365,
      "sparse_tokens": 32121.0,
      "step": 11287,
      "turn_loss": 0.06806866079568863,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5244378368333024,
      "grad_norm": 0.25551947951316833,
      "learning_rate": 8.861330505748222e-08,
      "loss": 0.0696,
      "mae_dtheta": 0.006092530209571123,
      "mae_dx": 0.000970579800195992,
      "mae_dy": 0.0015336978249251842,
      "pose_mae_dtheta": 0.036547355353832245,
      "pose_mae_dx": 0.012730937451124191,
      "pose_mae_dy": 0.01935419626533985,
      "pose_rmse_dtheta": 0.06849838048219681,
      "pose_rmse_dx": 0.0316988043487072,
      "pose_rmse_dy": 0.044518690556287766,
      "pose_rmse_mean": 0.04823862761259079,
      "rmse_dtheta": 0.012329689227044582,
      "rmse_dx": 0.0027145077474415302,
      "rmse_dy": 0.003416539868339896,
      "rmse_mean": 0.006153579335659742,
      "rotation_flip": 0.0015655577881261706,
      "sparse_tokens": 32121.0,
      "step": 11288,
      "turn_loss": 0.05209265276789665,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5244842965991452,
      "grad_norm": 0.43592357635498047,
      "learning_rate": 8.836564893799026e-08,
      "loss": 0.084,
      "mae_dtheta": 0.010985521599650383,
      "mae_dx": 0.0017572316573932767,
      "mae_dy": 0.0025211083702743053,
      "pose_mae_dtheta": 0.07798078656196594,
      "pose_mae_dx": 0.02548348344862461,
      "pose_mae_dy": 0.03348610922694206,
      "pose_rmse_dtheta": 0.1940307468175888,
      "pose_rmse_dx": 0.06711684912443161,
      "pose_rmse_dy": 0.07917773723602295,
      "pose_rmse_mean": 0.11344178020954132,
      "rmse_dtheta": 0.023879745975136757,
      "rmse_dx": 0.005631700158119202,
      "rmse_dy": 0.005335590336471796,
      "rmse_mean": 0.011615678668022156,
      "rotation_flip": 0.006468305364251137,
      "sparse_tokens": 32041.0,
      "step": 11289,
      "turn_loss": 0.10019229352474213,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5245307563649879,
      "grad_norm": 0.5414994955062866,
      "learning_rate": 8.811833629172428e-08,
      "loss": 0.1308,
      "mae_dtheta": 0.012682710774242878,
      "mae_dx": 0.002060339320451021,
      "mae_dy": 0.0027730802539736032,
      "pose_mae_dtheta": 0.08233147859573364,
      "pose_mae_dx": 0.020956818014383316,
      "pose_mae_dy": 0.028435997664928436,
      "pose_rmse_dtheta": 0.22330127656459808,
      "pose_rmse_dx": 0.05294786021113396,
      "pose_rmse_dy": 0.0643153190612793,
      "pose_rmse_mean": 0.11352148652076721,
      "rmse_dtheta": 0.028328895568847656,
      "rmse_dx": 0.006018512416630983,
      "rmse_dy": 0.005787133239209652,
      "rmse_mean": 0.01337818056344986,
      "rotation_flip": 0.010599414817988873,
      "sparse_tokens": 32105.0,
      "step": 11290,
      "turn_loss": 0.11087171733379364,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.5245772161308307,
      "grad_norm": 0.43962520360946655,
      "learning_rate": 8.787136713598043e-08,
      "loss": 0.084,
      "mae_dtheta": 0.02364625781774521,
      "mae_dx": 0.011041074059903622,
      "mae_dy": 0.002307705581188202,
      "pose_mae_dtheta": 0.1610012799501419,
      "pose_mae_dx": 0.0787980854511261,
      "pose_mae_dy": 0.025793274864554405,
      "pose_rmse_dtheta": 0.25859153270721436,
      "pose_rmse_dx": 0.1625204235315323,
      "pose_rmse_dy": 0.0388987734913826,
      "pose_rmse_mean": 0.15333691239356995,
      "rmse_dtheta": 0.04244881123304367,
      "rmse_dx": 0.02168959192931652,
      "rmse_dy": 0.00394917419180274,
      "rmse_mean": 0.022695859894156456,
      "rotation_flip": 0.005434782709926367,
      "sparse_tokens": 3312.0,
      "step": 11291,
      "turn_loss": 0.1997411996126175,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.5246236758966735,
      "grad_norm": 0.5594719052314758,
      "learning_rate": 8.762474148802713e-08,
      "loss": 0.1469,
      "mae_dtheta": 0.027350740507245064,
      "mae_dx": 0.009530816227197647,
      "mae_dy": 0.0025312656071037054,
      "pose_mae_dtheta": 0.18606793880462646,
      "pose_mae_dx": 0.07199280709028244,
      "pose_mae_dy": 0.02917023003101349,
      "pose_rmse_dtheta": 0.3278521001338959,
      "pose_rmse_dx": 0.17611068487167358,
      "pose_rmse_dy": 0.07542683929204941,
      "pose_rmse_mean": 0.19312986731529236,
      "rmse_dtheta": 0.04363853856921196,
      "rmse_dx": 0.021185660734772682,
      "rmse_dy": 0.005725253373384476,
      "rmse_mean": 0.023516487330198288,
      "rotation_flip": 0.012591815553605556,
      "sparse_tokens": 16793.0,
      "step": 11292,
      "turn_loss": 0.2115800827741623,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.5246701356625163,
      "grad_norm": 0.6572350859642029,
      "learning_rate": 8.737845936511335e-08,
      "loss": 0.1442,
      "mae_dtheta": 0.030391378328204155,
      "mae_dx": 0.01483354065567255,
      "mae_dy": 0.009387921541929245,
      "pose_mae_dtheta": 0.2550071179866791,
      "pose_mae_dx": 0.12824669480323792,
      "pose_mae_dy": 0.11100633442401886,
      "pose_rmse_dtheta": 0.39517050981521606,
      "pose_rmse_dx": 0.24637247622013092,
      "pose_rmse_dy": 0.2093520313501358,
      "pose_rmse_mean": 0.28363168239593506,
      "rmse_dtheta": 0.0433058962225914,
      "rmse_dx": 0.027170246466994286,
      "rmse_dy": 0.01760060340166092,
      "rmse_mean": 0.029358915984630585,
      "rotation_flip": 0.020361991599202156,
      "sparse_tokens": 7871.0,
      "step": 11293,
      "turn_loss": 0.26702579855918884,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.524716595428359,
      "grad_norm": 0.4919723570346832,
      "learning_rate": 8.713252078446033e-08,
      "loss": 0.1065,
      "mae_dtheta": 0.008217018097639084,
      "mae_dx": 0.001320147537626326,
      "mae_dy": 0.0017145052552223206,
      "pose_mae_dtheta": 0.056819260120391846,
      "pose_mae_dx": 0.015972493216395378,
      "pose_mae_dy": 0.02124749682843685,
      "pose_rmse_dtheta": 0.1586012840270996,
      "pose_rmse_dx": 0.041338253766298294,
      "pose_rmse_dy": 0.053177282214164734,
      "pose_rmse_mean": 0.08437227457761765,
      "rmse_dtheta": 0.01905788667500019,
      "rmse_dx": 0.004272326827049255,
      "rmse_dy": 0.003949434030801058,
      "rmse_mean": 0.009093215689063072,
      "rotation_flip": 0.0036764706019312143,
      "sparse_tokens": 32105.0,
      "step": 11294,
      "turn_loss": 0.06460251659154892,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.5247630551942019,
      "grad_norm": 0.49993354082107544,
      "learning_rate": 8.688692576326707e-08,
      "loss": 0.1119,
      "mae_dtheta": 0.03189864382147789,
      "mae_dx": 0.009747195988893509,
      "mae_dy": 0.0032648961059749126,
      "pose_mae_dtheta": 0.2540554404258728,
      "pose_mae_dx": 0.06612987816333771,
      "pose_mae_dy": 0.03722131624817848,
      "pose_rmse_dtheta": 0.48234450817108154,
      "pose_rmse_dx": 0.14529438316822052,
      "pose_rmse_dy": 0.11218404024839401,
      "pose_rmse_mean": 0.24660764634609222,
      "rmse_dtheta": 0.05025716871023178,
      "rmse_dx": 0.020302169024944305,
      "rmse_dy": 0.008561205118894577,
      "rmse_mean": 0.026373516768217087,
      "rotation_flip": 0.003963011782616377,
      "sparse_tokens": 11537.0,
      "step": 11295,
      "turn_loss": 0.2307700663805008,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.5248095149600446,
      "grad_norm": 0.9410716891288757,
      "learning_rate": 8.664167431870762e-08,
      "loss": 0.1824,
      "mae_dtheta": 0.040405917912721634,
      "mae_dx": 0.018193289637565613,
      "mae_dy": 0.010345231741666794,
      "pose_mae_dtheta": 0.3381190598011017,
      "pose_mae_dx": 0.14616984128952026,
      "pose_mae_dy": 0.11769020557403564,
      "pose_rmse_dtheta": 0.5528144240379333,
      "pose_rmse_dx": 0.29294347763061523,
      "pose_rmse_dy": 0.3108404874801636,
      "pose_rmse_mean": 0.38553279638290405,
      "rmse_dtheta": 0.05722574517130852,
      "rmse_dx": 0.03191707655787468,
      "rmse_dy": 0.022645756602287292,
      "rmse_mean": 0.03726286068558693,
      "rotation_flip": 0.007320644333958626,
      "sparse_tokens": 12394.0,
      "step": 11296,
      "turn_loss": 0.42936238646507263,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 27170.0,
      "epoch": 0.5248559747258874,
      "grad_norm": 0.46101269125938416,
      "learning_rate": 8.639676646793382e-08,
      "loss": 0.0852,
      "mae_dtheta": 0.02391377091407776,
      "mae_dx": 0.010800906457006931,
      "mae_dy": 0.003635436063632369,
      "pose_mae_dtheta": 0.17526409029960632,
      "pose_mae_dx": 0.084994375705719,
      "pose_mae_dy": 0.05100023373961449,
      "pose_rmse_dtheta": 0.3030890226364136,
      "pose_rmse_dx": 0.2223912626504898,
      "pose_rmse_dy": 0.11811818927526474,
      "pose_rmse_mean": 0.21453282237052917,
      "rmse_dtheta": 0.037843458354473114,
      "rmse_dx": 0.02416357211768627,
      "rmse_dy": 0.007130774669349194,
      "rmse_mean": 0.023045934736728668,
      "rotation_flip": 0.00638977624475956,
      "sparse_tokens": 20575.0,
      "step": 11297,
      "turn_loss": 0.19265295565128326,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5249024344917301,
      "grad_norm": 0.4384404718875885,
      "learning_rate": 8.615220222807085e-08,
      "loss": 0.0752,
      "mae_dtheta": 0.00828308891505003,
      "mae_dx": 0.0017150769708678126,
      "mae_dy": 0.0015407033497467637,
      "pose_mae_dtheta": 0.06314415484666824,
      "pose_mae_dx": 0.018163440749049187,
      "pose_mae_dy": 0.017429543659090996,
      "pose_rmse_dtheta": 0.21142302453517914,
      "pose_rmse_dx": 0.058049947023391724,
      "pose_rmse_dy": 0.06177150458097458,
      "pose_rmse_mean": 0.11041482537984848,
      "rmse_dtheta": 0.023943791165947914,
      "rmse_dx": 0.00615460192784667,
      "rmse_dy": 0.0048757269978523254,
      "rmse_mean": 0.011658040806651115,
      "rotation_flip": 0.005266622640192509,
      "sparse_tokens": 32073.0,
      "step": 11298,
      "turn_loss": 0.062210794538259506,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.524948894257573,
      "grad_norm": 0.38097044825553894,
      "learning_rate": 8.590798161622227e-08,
      "loss": 0.0833,
      "mae_dtheta": 0.007371095009148121,
      "mae_dx": 0.0015031697694212198,
      "mae_dy": 0.0024912592489272356,
      "pose_mae_dtheta": 0.04905217885971069,
      "pose_mae_dx": 0.02212059684097767,
      "pose_mae_dy": 0.024808794260025024,
      "pose_rmse_dtheta": 0.12369702011346817,
      "pose_rmse_dx": 0.06320157647132874,
      "pose_rmse_dy": 0.06649725884199142,
      "pose_rmse_mean": 0.08446528762578964,
      "rmse_dtheta": 0.0166481863707304,
      "rmse_dx": 0.00413406640291214,
      "rmse_dy": 0.006509312428534031,
      "rmse_mean": 0.009097188711166382,
      "rotation_flip": 0.007587859407067299,
      "sparse_tokens": 32105.0,
      "step": 11299,
      "turn_loss": 0.06933095306158066,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17157.0,
      "epoch": 0.5249953540234157,
      "grad_norm": 0.4256819784641266,
      "learning_rate": 8.56641046494655e-08,
      "loss": 0.0962,
      "mae_dtheta": 0.038484107702970505,
      "mae_dx": 0.012290948070585728,
      "mae_dy": 0.0032445951364934444,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4256818890571594,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.7346954345703,
      "model/head/act_norm_mean": 103.55579304245283,
      "model/head/act_norm_min": 70.51911926269531,
      "model/head/act_over_embed": 71.16451048338284,
      "model/head/grad_frac": 0.09532181918621063,
      "model/head/grad_norm": 0.04057677090167999,
      "model/head/grad_zero_frac": 0.00019797758432105184,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6954967570754716,
      "model/head/update_ratio": 0.0006907299975864589,
      "model/head/weight_delta": 9.98457145690918,
      "model/head/weight_delta_rel": 0.17515896260738373,
      "model/head/weight_norm": 58.74476623535156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228663742542267,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228663742542267,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228663742542267,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059773132487443,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09005651623010635,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03833542764186859,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012378310784697533,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156501531600952,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313273966312408,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969837188720703,
      "model/modality_embedder/grad_frac": 0.09005651623010635,
      "model/modality_embedder/grad_norm": 0.03833542764186859,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0012378310784697533,
      "model/modality_embedder/weight_delta": 3.156501531600952,
      "model/modality_embedder/weight_delta_rel": 0.10313273966312408,
      "model/modality_embedder/weight_norm": 30.969837188720703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 80.19837951660156,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.01410882749326,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.34701156616211,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.815511047734862,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.052947718650102615,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.022538885474205017,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008060803520493209,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7420389652252197,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09992155432701111,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961090087890625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.4339599609375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.811975890985323,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.89214038848877,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.363812763515746,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05315382778644562,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.022626621648669243,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002975710085593164,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007600309327244759,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4765310287475586,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12042975425720215,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770658493041992,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.11262512207031,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.438590333932314,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.212442398071289,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.48163743731326,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05156157538294792,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.021948829293251038,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0003580939373932779,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007139624794945121,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.766423225402832,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1264694333076477,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742273330688477,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.87976837158203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.27288063417191,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.968381881713867,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.742178904534267,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.04424087703227997,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.01883254013955593,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00036818109219893813,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006286832503974438,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2375800609588623,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1106451228260994,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955530166625977,
      "model/normalizer/grad_frac": 0.16325172781944275,
      "model/normalizer/grad_norm": 0.06949330121278763,
      "model/normalizer/grad_zero_frac": 0.00032497805659659207,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0008834886830300093,
      "model/normalizer/weight_delta": 6.808606147766113,
      "model/normalizer/weight_delta_rel": 0.08769090473651886,
      "model/normalizer/weight_norm": 78.65782928466797,
      "pose_mae_dtheta": 0.32507187128067017,
      "pose_mae_dx": 0.09875930845737457,
      "pose_mae_dy": 0.04355732351541519,
      "pose_rmse_dtheta": 0.5728780031204224,
      "pose_rmse_dx": 0.21268866956233978,
      "pose_rmse_dy": 0.12116288393735886,
      "pose_rmse_mean": 0.3022432029247284,
      "rmse_dtheta": 0.05834008753299713,
      "rmse_dx": 0.025628799572587013,
      "rmse_dy": 0.006722788326442242,
      "rmse_mean": 0.030230557546019554,
      "rotation_flip": 0.011070110835134983,
      "sparse_tokens": 14576.0,
      "step": 11300,
      "turn_loss": 0.25358009338378906,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 23940.0,
      "epoch": 0.5250418137892585,
      "grad_norm": 1.1099438667297363,
      "learning_rate": 8.542057134485638e-08,
      "loss": 0.1891,
      "mae_dtheta": 0.033892132341861725,
      "mae_dx": 0.015313906595110893,
      "mae_dy": 0.0050737191922962666,
      "pose_mae_dtheta": 0.2543155550956726,
      "pose_mae_dx": 0.12466010451316833,
      "pose_mae_dy": 0.06520366668701172,
      "pose_rmse_dtheta": 0.4285653531551361,
      "pose_rmse_dx": 0.27311310172080994,
      "pose_rmse_dy": 0.14826515316963196,
      "pose_rmse_mean": 0.2833145558834076,
      "rmse_dtheta": 0.05035856366157532,
      "rmse_dx": 0.029191991314291954,
      "rmse_dy": 0.011091922409832478,
      "rmse_mean": 0.030214160680770874,
      "rotation_flip": 0.01575532928109169,
      "sparse_tokens": 19490.0,
      "step": 11301,
      "turn_loss": 0.3299349844455719,
      "turns": 74.0,
      "turns_per_sample": 74.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.5250882735551012,
      "grad_norm": 0.6421778798103333,
      "learning_rate": 8.517738171942346e-08,
      "loss": 0.1488,
      "mae_dtheta": 0.0325375497341156,
      "mae_dx": 0.01118819322437048,
      "mae_dy": 0.005897467024624348,
      "pose_mae_dtheta": 0.25697121024131775,
      "pose_mae_dx": 0.0900871679186821,
      "pose_mae_dy": 0.06538475304841995,
      "pose_rmse_dtheta": 0.47463032603263855,
      "pose_rmse_dx": 0.18344691395759583,
      "pose_rmse_dy": 0.16823892295360565,
      "pose_rmse_mean": 0.27543872594833374,
      "rmse_dtheta": 0.05090254917740822,
      "rmse_dx": 0.023067476227879524,
      "rmse_dy": 0.012715284712612629,
      "rmse_mean": 0.02889510616660118,
      "rotation_flip": 0.012605042196810246,
      "sparse_tokens": 16511.0,
      "step": 11302,
      "turn_loss": 0.21430599689483643,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 33738.0,
      "epoch": 0.5251347333209441,
      "grad_norm": 0.40152329206466675,
      "learning_rate": 8.49345357901754e-08,
      "loss": 0.0839,
      "mae_dtheta": 0.030063316226005554,
      "mae_dx": 0.009773558005690575,
      "mae_dy": 0.0035534182097762823,
      "pose_mae_dtheta": 0.23181681334972382,
      "pose_mae_dx": 0.07463555037975311,
      "pose_mae_dy": 0.03982137516140938,
      "pose_rmse_dtheta": 0.4381919801235199,
      "pose_rmse_dx": 0.1823602318763733,
      "pose_rmse_dy": 0.09841512143611908,
      "pose_rmse_mean": 0.2396557778120041,
      "rmse_dtheta": 0.04950767010450363,
      "rmse_dx": 0.021370407193899155,
      "rmse_dy": 0.007689730729907751,
      "rmse_mean": 0.02618926763534546,
      "rotation_flip": 0.012747875414788723,
      "sparse_tokens": 26600.0,
      "step": 11303,
      "turn_loss": 0.21802251040935516,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 34713.0,
      "epoch": 0.5251811930867868,
      "grad_norm": 0.5718473196029663,
      "learning_rate": 8.46920335740925e-08,
      "loss": 0.144,
      "mae_dtheta": 0.025304075330495834,
      "mae_dx": 0.007007977459579706,
      "mae_dy": 0.0031836372800171375,
      "pose_mae_dtheta": 0.18695668876171112,
      "pose_mae_dx": 0.05582037940621376,
      "pose_mae_dy": 0.04680589213967323,
      "pose_rmse_dtheta": 0.36730045080184937,
      "pose_rmse_dx": 0.13759632408618927,
      "pose_rmse_dy": 0.10995479673147202,
      "pose_rmse_mean": 0.2049505114555359,
      "rmse_dtheta": 0.04368101432919502,
      "rmse_dx": 0.01768427900969982,
      "rmse_dy": 0.006341057363897562,
      "rmse_mean": 0.022568782791495323,
      "rotation_flip": 0.011149825528264046,
      "sparse_tokens": 27165.0,
      "step": 11304,
      "turn_loss": 0.17412042617797852,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5252276528526296,
      "grad_norm": 0.37902581691741943,
      "learning_rate": 8.444987508813451e-08,
      "loss": 0.1207,
      "mae_dtheta": 0.009339077398180962,
      "mae_dx": 0.002427942818030715,
      "mae_dy": 0.0017382759833708405,
      "pose_mae_dtheta": 0.0647081509232521,
      "pose_mae_dx": 0.02522318810224533,
      "pose_mae_dy": 0.0230428334325552,
      "pose_rmse_dtheta": 0.1825525313615799,
      "pose_rmse_dx": 0.06144171580672264,
      "pose_rmse_dy": 0.055474214255809784,
      "pose_rmse_mean": 0.09982281923294067,
      "rmse_dtheta": 0.02187756821513176,
      "rmse_dx": 0.007604564540088177,
      "rmse_dy": 0.003426705254241824,
      "rmse_mean": 0.010969612747430801,
      "rotation_flip": 0.0033832769840955734,
      "sparse_tokens": 32073.0,
      "step": 11305,
      "turn_loss": 0.09644714742898941,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.5252741126184725,
      "grad_norm": 0.4455448389053345,
      "learning_rate": 8.420806034923401e-08,
      "loss": 0.0839,
      "mae_dtheta": 0.027730906382203102,
      "mae_dx": 0.00867136474698782,
      "mae_dy": 0.0030383721459656954,
      "pose_mae_dtheta": 0.2101341038942337,
      "pose_mae_dx": 0.060585785657167435,
      "pose_mae_dy": 0.03642304986715317,
      "pose_rmse_dtheta": 0.4301435351371765,
      "pose_rmse_dx": 0.1689646989107132,
      "pose_rmse_dy": 0.08600016683340073,
      "pose_rmse_mean": 0.22836945950984955,
      "rmse_dtheta": 0.04901941865682602,
      "rmse_dx": 0.020298469811677933,
      "rmse_dy": 0.005996332038193941,
      "rmse_mean": 0.025104742497205734,
      "rotation_flip": 0.01989150047302246,
      "sparse_tokens": 9456.0,
      "step": 11306,
      "turn_loss": 0.16245420277118683,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5253205723843152,
      "grad_norm": 0.6731252670288086,
      "learning_rate": 8.396658937430302e-08,
      "loss": 0.1588,
      "mae_dtheta": 0.008351343683898449,
      "mae_dx": 0.001245504361577332,
      "mae_dy": 0.001836456940509379,
      "pose_mae_dtheta": 0.05007634684443474,
      "pose_mae_dx": 0.018236374482512474,
      "pose_mae_dy": 0.020602308213710785,
      "pose_rmse_dtheta": 0.1253967583179474,
      "pose_rmse_dx": 0.0499839261174202,
      "pose_rmse_dy": 0.04644409194588661,
      "pose_rmse_mean": 0.07394158840179443,
      "rmse_dtheta": 0.018708480522036552,
      "rmse_dx": 0.003701749024912715,
      "rmse_dy": 0.004203510470688343,
      "rmse_mean": 0.008871246129274368,
      "rotation_flip": 0.003034243592992425,
      "sparse_tokens": 32057.0,
      "step": 11307,
      "turn_loss": 0.06711629778146744,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.525367032150158,
      "grad_norm": 0.5234450697898865,
      "learning_rate": 8.372546218022747e-08,
      "loss": 0.1397,
      "mae_dtheta": 0.014186756685376167,
      "mae_dx": 0.0044412920251488686,
      "mae_dy": 0.0049225338734686375,
      "pose_mae_dtheta": 0.10358086973428726,
      "pose_mae_dx": 0.03850806504487991,
      "pose_mae_dy": 0.04164207726716995,
      "pose_rmse_dtheta": 0.23044520616531372,
      "pose_rmse_dx": 0.09945112466812134,
      "pose_rmse_dy": 0.09100151062011719,
      "pose_rmse_mean": 0.14029929041862488,
      "rmse_dtheta": 0.0275189820677042,
      "rmse_dx": 0.010791122913360596,
      "rmse_dy": 0.01107825431972742,
      "rmse_mean": 0.016462786123156548,
      "rotation_flip": 0.008544303476810455,
      "sparse_tokens": 32169.0,
      "step": 11308,
      "turn_loss": 0.1651228964328766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5254134919160007,
      "grad_norm": 0.3728286623954773,
      "learning_rate": 8.348467878386834e-08,
      "loss": 0.0917,
      "mae_dtheta": 0.007131726481020451,
      "mae_dx": 0.000876633042935282,
      "mae_dy": 0.0016286807367578149,
      "pose_mae_dtheta": 0.046592455357313156,
      "pose_mae_dx": 0.014831872656941414,
      "pose_mae_dy": 0.02011522836983204,
      "pose_rmse_dtheta": 0.12993068993091583,
      "pose_rmse_dx": 0.04860907420516014,
      "pose_rmse_dy": 0.05166352167725563,
      "pose_rmse_mean": 0.07673443108797073,
      "rmse_dtheta": 0.019232630729675293,
      "rmse_dx": 0.0025932167191058397,
      "rmse_dy": 0.004040209110826254,
      "rmse_mean": 0.008622019551694393,
      "rotation_flip": 0.0051165432669222355,
      "sparse_tokens": 32041.0,
      "step": 11309,
      "turn_loss": 0.0528867170214653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5254599516818436,
      "grad_norm": 0.3449508845806122,
      "learning_rate": 8.324423920206492e-08,
      "loss": 0.1115,
      "mae_dtheta": 0.00673943106085062,
      "mae_dx": 0.0011472763726487756,
      "mae_dy": 0.0015275042969733477,
      "pose_mae_dtheta": 0.0437176376581192,
      "pose_mae_dx": 0.015721874311566353,
      "pose_mae_dy": 0.019572414457798004,
      "pose_rmse_dtheta": 0.0956176295876503,
      "pose_rmse_dx": 0.04341088980436325,
      "pose_rmse_dy": 0.050735510885715485,
      "pose_rmse_mean": 0.06325467675924301,
      "rmse_dtheta": 0.015108413062989712,
      "rmse_dx": 0.003479880280792713,
      "rmse_dy": 0.003645018208771944,
      "rmse_mean": 0.007411103695631027,
      "rotation_flip": 0.001065530115738511,
      "sparse_tokens": 32073.0,
      "step": 11310,
      "turn_loss": 0.05522840842604637,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.5255064114476863,
      "grad_norm": 0.9958582520484924,
      "learning_rate": 8.300414345163043e-08,
      "loss": 0.2466,
      "mae_dtheta": 0.03910340368747711,
      "mae_dx": 0.016077375039458275,
      "mae_dy": 0.0028419876471161842,
      "pose_mae_dtheta": 0.34245455265045166,
      "pose_mae_dx": 0.1560930460691452,
      "pose_mae_dy": 0.024402473121881485,
      "pose_rmse_dtheta": 0.5231024622917175,
      "pose_rmse_dx": 0.32118740677833557,
      "pose_rmse_dy": 0.05374203994870186,
      "pose_rmse_mean": 0.299344003200531,
      "rmse_dtheta": 0.05506616085767746,
      "rmse_dx": 0.029422061517834663,
      "rmse_dy": 0.007088035345077515,
      "rmse_mean": 0.030525419861078262,
      "rotation_flip": 0.0243055559694767,
      "sparse_tokens": 9314.0,
      "step": 11311,
      "turn_loss": 0.3073413372039795,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5255528712135291,
      "grad_norm": 0.35923895239830017,
      "learning_rate": 8.27643915493559e-08,
      "loss": 0.0713,
      "mae_dtheta": 0.00679099140688777,
      "mae_dx": 0.0012115144636482,
      "mae_dy": 0.0012889354256913066,
      "pose_mae_dtheta": 0.04677204415202141,
      "pose_mae_dx": 0.011427213437855244,
      "pose_mae_dy": 0.016342999413609505,
      "pose_rmse_dtheta": 0.16451632976531982,
      "pose_rmse_dx": 0.03750178590416908,
      "pose_rmse_dy": 0.05896737799048424,
      "pose_rmse_mean": 0.08699516952037811,
      "rmse_dtheta": 0.020413879305124283,
      "rmse_dx": 0.00427883118391037,
      "rmse_dy": 0.004393254406750202,
      "rmse_mean": 0.009695321321487427,
      "rotation_flip": 0.0033025098964571953,
      "sparse_tokens": 32073.0,
      "step": 11312,
      "turn_loss": 0.057534731924533844,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.5255993309793718,
      "grad_norm": 0.6747896075248718,
      "learning_rate": 8.252498351200621e-08,
      "loss": 0.1568,
      "mae_dtheta": 0.051620859652757645,
      "mae_dx": 0.012729968875646591,
      "mae_dy": 0.0038496365305036306,
      "pose_mae_dtheta": 0.45221012830734253,
      "pose_mae_dx": 0.10296740382909775,
      "pose_mae_dy": 0.04535135254263878,
      "pose_rmse_dtheta": 0.672114372253418,
      "pose_rmse_dx": 0.2542243003845215,
      "pose_rmse_dy": 0.11560571193695068,
      "pose_rmse_mean": 0.3473148047924042,
      "rmse_dtheta": 0.0692865252494812,
      "rmse_dx": 0.02611938677728176,
      "rmse_dy": 0.00994727574288845,
      "rmse_mean": 0.035117730498313904,
      "rotation_flip": 0.010223048739135265,
      "sparse_tokens": 14656.0,
      "step": 11313,
      "turn_loss": 0.39782366156578064,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5256457907452147,
      "grad_norm": 0.533615231513977,
      "learning_rate": 8.228591935632413e-08,
      "loss": 0.1201,
      "mae_dtheta": 0.00717413704842329,
      "mae_dx": 0.0011481879046186805,
      "mae_dy": 0.0016197208315134048,
      "pose_mae_dtheta": 0.04988229274749756,
      "pose_mae_dx": 0.01629221998155117,
      "pose_mae_dy": 0.02319459244608879,
      "pose_rmse_dtheta": 0.1328226923942566,
      "pose_rmse_dx": 0.052972592413425446,
      "pose_rmse_dy": 0.07389514148235321,
      "pose_rmse_mean": 0.08656346797943115,
      "rmse_dtheta": 0.018601007759571075,
      "rmse_dx": 0.005004928447306156,
      "rmse_dy": 0.004087136592715979,
      "rmse_mean": 0.0092310244217515,
      "rotation_flip": 0.002111932495608926,
      "sparse_tokens": 32041.0,
      "step": 11314,
      "turn_loss": 0.0573885478079319,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.5256922505110574,
      "grad_norm": 0.6234518885612488,
      "learning_rate": 8.204719909902681e-08,
      "loss": 0.1398,
      "mae_dtheta": 0.04252208396792412,
      "mae_dx": 0.009861855767667294,
      "mae_dy": 0.005988691467791796,
      "pose_mae_dtheta": 0.3659902811050415,
      "pose_mae_dx": 0.08271890878677368,
      "pose_mae_dy": 0.05391288176178932,
      "pose_rmse_dtheta": 0.6358113884925842,
      "pose_rmse_dx": 0.20481732487678528,
      "pose_rmse_dy": 0.1521560549736023,
      "pose_rmse_mean": 0.3309282660484314,
      "rmse_dtheta": 0.06434667855501175,
      "rmse_dx": 0.02183702029287815,
      "rmse_dy": 0.016097083687782288,
      "rmse_mean": 0.034093596041202545,
      "rotation_flip": 0.02384737692773342,
      "sparse_tokens": 10839.0,
      "step": 11315,
      "turn_loss": 0.32237908244132996,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5257387102769002,
      "grad_norm": 0.5556375980377197,
      "learning_rate": 8.180882275680868e-08,
      "loss": 0.1156,
      "mae_dtheta": 0.00759225944057107,
      "mae_dx": 0.0010753592941910028,
      "mae_dy": 0.0009229941642843187,
      "pose_mae_dtheta": 0.04772455245256424,
      "pose_mae_dx": 0.010263632982969284,
      "pose_mae_dy": 0.01268190797418356,
      "pose_rmse_dtheta": 0.16864228248596191,
      "pose_rmse_dx": 0.029056783765554428,
      "pose_rmse_dy": 0.036350689828395844,
      "pose_rmse_mean": 0.07801659405231476,
      "rmse_dtheta": 0.02336231805384159,
      "rmse_dx": 0.003376211505383253,
      "rmse_dy": 0.0023710166569799185,
      "rmse_mean": 0.009703182615339756,
      "rotation_flip": 0.001279863528907299,
      "sparse_tokens": 32185.0,
      "step": 11316,
      "turn_loss": 0.054238203912973404,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.5257851700427429,
      "grad_norm": 0.8072523474693298,
      "learning_rate": 8.157079034633974e-08,
      "loss": 0.2533,
      "mae_dtheta": 0.032114434987306595,
      "mae_dx": 0.010252835229039192,
      "mae_dy": 0.007097173016518354,
      "pose_mae_dtheta": 0.24788638949394226,
      "pose_mae_dx": 0.07397102564573288,
      "pose_mae_dy": 0.08006685227155685,
      "pose_rmse_dtheta": 0.4412090480327606,
      "pose_rmse_dx": 0.17486631870269775,
      "pose_rmse_dy": 0.18736140429973602,
      "pose_rmse_mean": 0.2678122818470001,
      "rmse_dtheta": 0.04987435042858124,
      "rmse_dx": 0.021601494401693344,
      "rmse_dy": 0.015508429147303104,
      "rmse_mean": 0.028994759544730186,
      "rotation_flip": 0.011324041523039341,
      "sparse_tokens": 19226.0,
      "step": 11317,
      "turn_loss": 0.29937222599983215,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5258316298085858,
      "grad_norm": 0.5346940755844116,
      "learning_rate": 8.133310188426502e-08,
      "loss": 0.1104,
      "mae_dtheta": 0.009083895944058895,
      "mae_dx": 0.0013508620904758573,
      "mae_dy": 0.001849669381044805,
      "pose_mae_dtheta": 0.059019073843955994,
      "pose_mae_dx": 0.014923960901796818,
      "pose_mae_dy": 0.02343173697590828,
      "pose_rmse_dtheta": 0.1654743105173111,
      "pose_rmse_dx": 0.04636590927839279,
      "pose_rmse_dy": 0.055023442953825,
      "pose_rmse_mean": 0.08895455300807953,
      "rmse_dtheta": 0.02047817036509514,
      "rmse_dx": 0.004131222143769264,
      "rmse_dy": 0.004605138674378395,
      "rmse_mean": 0.009738177061080933,
      "rotation_flip": 0.005711565725505352,
      "sparse_tokens": 32089.0,
      "step": 11318,
      "turn_loss": 0.07208820432424545,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 39913.0,
      "epoch": 0.5258780895744285,
      "grad_norm": 0.552527904510498,
      "learning_rate": 8.109575738720621e-08,
      "loss": 0.1465,
      "mae_dtheta": 0.0364358052611351,
      "mae_dx": 0.008105773478746414,
      "mae_dy": 0.0038961805403232574,
      "pose_mae_dtheta": 0.2860422432422638,
      "pose_mae_dx": 0.06633233278989792,
      "pose_mae_dy": 0.0387284941971302,
      "pose_rmse_dtheta": 0.5060217380523682,
      "pose_rmse_dx": 0.1538960188627243,
      "pose_rmse_dy": 0.09544922411441803,
      "pose_rmse_mean": 0.25178900361061096,
      "rmse_dtheta": 0.05619065463542938,
      "rmse_dx": 0.01818986050784588,
      "rmse_dy": 0.0101022245362401,
      "rmse_mean": 0.02816091477870941,
      "rotation_flip": 0.013041210360825062,
      "sparse_tokens": 30013.0,
      "step": 11319,
      "turn_loss": 0.2483222782611847,
      "turns": 123.0,
      "turns_per_sample": 123.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.5259245493402713,
      "grad_norm": 0.4356374442577362,
      "learning_rate": 8.08587568717617e-08,
      "loss": 0.0832,
      "mae_dtheta": 0.020406676456332207,
      "mae_dx": 0.007542542181909084,
      "mae_dy": 0.00347440829500556,
      "pose_mae_dtheta": 0.15731248259544373,
      "pose_mae_dx": 0.05870792642235756,
      "pose_mae_dy": 0.04672800004482269,
      "pose_rmse_dtheta": 0.3071615993976593,
      "pose_rmse_dx": 0.14716452360153198,
      "pose_rmse_dy": 0.11466947942972183,
      "pose_rmse_mean": 0.18966519832611084,
      "rmse_dtheta": 0.03589669615030289,
      "rmse_dx": 0.018208427354693413,
      "rmse_dy": 0.007018269505351782,
      "rmse_mean": 0.020374465733766556,
      "rotation_flip": 0.010794896632432938,
      "sparse_tokens": 18800.0,
      "step": 11320,
      "turn_loss": 0.15321801602840424,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.525971009106114,
      "grad_norm": 0.49238526821136475,
      "learning_rate": 8.06221003545038e-08,
      "loss": 0.122,
      "mae_dtheta": 0.010805785655975342,
      "mae_dx": 0.001604174729436636,
      "mae_dy": 0.002194194355979562,
      "pose_mae_dtheta": 0.06289590895175934,
      "pose_mae_dx": 0.01984255760908127,
      "pose_mae_dy": 0.022369787096977234,
      "pose_rmse_dtheta": 0.14401423931121826,
      "pose_rmse_dx": 0.04415811598300934,
      "pose_rmse_dy": 0.053597964346408844,
      "pose_rmse_mean": 0.08059011399745941,
      "rmse_dtheta": 0.02251266874372959,
      "rmse_dx": 0.004057056736201048,
      "rmse_dy": 0.004332419950515032,
      "rmse_mean": 0.010300715453922749,
      "rotation_flip": 0.00699533661827445,
      "sparse_tokens": 32169.0,
      "step": 11321,
      "turn_loss": 0.08658567070960999,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5260174688719569,
      "grad_norm": 0.3672129809856415,
      "learning_rate": 8.03857878519837e-08,
      "loss": 0.0667,
      "mae_dtheta": 0.007083639036864042,
      "mae_dx": 0.0009320101817138493,
      "mae_dy": 0.0014952343190088868,
      "pose_mae_dtheta": 0.04799508675932884,
      "pose_mae_dx": 0.012950766831636429,
      "pose_mae_dy": 0.0184861458837986,
      "pose_rmse_dtheta": 0.143560990691185,
      "pose_rmse_dx": 0.03296096250414848,
      "pose_rmse_dy": 0.04729880392551422,
      "pose_rmse_mean": 0.07460692524909973,
      "rmse_dtheta": 0.018986795097589493,
      "rmse_dx": 0.0026404564268887043,
      "rmse_dy": 0.0033188071101903915,
      "rmse_mean": 0.008315352723002434,
      "rotation_flip": 0.0049773757345974445,
      "sparse_tokens": 32089.0,
      "step": 11322,
      "turn_loss": 0.05494556576013565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.5260639286377997,
      "grad_norm": 0.36696434020996094,
      "learning_rate": 8.014981938072542e-08,
      "loss": 0.0894,
      "mae_dtheta": 0.014472792856395245,
      "mae_dx": 0.003095421241596341,
      "mae_dy": 0.0035575400106608868,
      "pose_mae_dtheta": 0.10255289822816849,
      "pose_mae_dx": 0.025096848607063293,
      "pose_mae_dy": 0.028409719467163086,
      "pose_rmse_dtheta": 0.2609492242336273,
      "pose_rmse_dx": 0.06570897996425629,
      "pose_rmse_dy": 0.0697430893778801,
      "pose_rmse_mean": 0.13213376700878143,
      "rmse_dtheta": 0.03270884230732918,
      "rmse_dx": 0.008537700399756432,
      "rmse_dy": 0.010109266266226768,
      "rmse_mean": 0.017118602991104126,
      "rotation_flip": 0.006268558092415333,
      "sparse_tokens": 32233.0,
      "step": 11323,
      "turn_loss": 0.12935155630111694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.5261103884036424,
      "grad_norm": 0.5971314907073975,
      "learning_rate": 7.99141949572313e-08,
      "loss": 0.1169,
      "mae_dtheta": 0.03208956867456436,
      "mae_dx": 0.008893630467355251,
      "mae_dy": 0.0037578572519123554,
      "pose_mae_dtheta": 0.2867989242076874,
      "pose_mae_dx": 0.07231792062520981,
      "pose_mae_dy": 0.05391376465559006,
      "pose_rmse_dtheta": 0.5498338937759399,
      "pose_rmse_dx": 0.17144690454006195,
      "pose_rmse_dy": 0.14248017966747284,
      "pose_rmse_mean": 0.28792035579681396,
      "rmse_dtheta": 0.05269927904009819,
      "rmse_dx": 0.02108040638267994,
      "rmse_dy": 0.0081505561247468,
      "rmse_mean": 0.0273100808262825,
      "rotation_flip": 0.01151315774768591,
      "sparse_tokens": 11370.0,
      "step": 11324,
      "turn_loss": 0.19347649812698364,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5261568481694853,
      "grad_norm": 0.431624174118042,
      "learning_rate": 7.967891459797817e-08,
      "loss": 0.0696,
      "mae_dtheta": 0.009316805750131607,
      "mae_dx": 0.0017074295319616795,
      "mae_dy": 0.0017364060040563345,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4316241145133972,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 159.68760681152344,
      "model/head/act_norm_mean": 111.5845367739899,
      "model/head/act_norm_min": 53.51033401489258,
      "model/head/act_over_embed": 76.6819383419782,
      "model/head/grad_frac": 0.08112766593694687,
      "model/head/grad_norm": 0.035016655921936035,
      "model/head/grad_zero_frac": 0.00020337120804470032,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7090928819444444,
      "model/head/update_ratio": 0.0005960810813121498,
      "model/head/weight_delta": 9.984732627868652,
      "model/head/weight_delta_rel": 0.17516177892684937,
      "model/head/weight_norm": 58.744789123535156,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42298102378845215,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228714399808191,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42280077934265137,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2906012125396148,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08655235171318054,
      "model/modality_embedder.encoders.pose/grad_norm": 0.037358082830905914,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5457451653587444,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001206273096613586,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156555652618408,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313451290130615,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969839096069336,
      "model/modality_embedder/grad_frac": 0.08655235171318054,
      "model/modality_embedder/grad_norm": 0.037358082830905914,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5457451653587444,
      "model/modality_embedder/update_ratio": 0.001206273096613586,
      "model/modality_embedder/weight_delta": 3.156555652618408,
      "model/modality_embedder/weight_delta_rel": 0.10313451290130615,
      "model/modality_embedder/weight_norm": 30.969839096069336,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 89.5188217163086,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.745290203623536,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.937155723571777,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.317985734839482,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.037756163626909256,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.016296470537781715,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00028748385375365615,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0005828263820149004,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7421257495880127,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0999247133731842,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96110725402832,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.64136505126953,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.692397687189352,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.277344703674316,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.968846864505874,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.039322782307863235,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.016972661018371582,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0005701133050024509,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4766409397125244,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12043356150388718,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770679473876953,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.04727172851562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.44572460718294,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.548515319824219,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.173749538830712,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.03969358652830124,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.017132708802819252,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0005573009257204831,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.766551971435547,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12647376954555511,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742292404174805,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.5072021484375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.16060405643739,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.476993560791016,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.352230751312725,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.039882417768239975,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.01721421256661415,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0003429632051847875,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.00057465850841254,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2377054691314697,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11064940690994263,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955551147460938,
      "model/normalizer/grad_frac": 0.13408488035202026,
      "model/normalizer/grad_norm": 0.05787426978349686,
      "model/normalizer/grad_zero_frac": 0.0002883441629819572,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0007357723661698401,
      "model/normalizer/weight_delta": 6.808837413787842,
      "model/normalizer/weight_delta_rel": 0.08769388496875763,
      "model/normalizer/weight_norm": 78.65784454345703,
      "pose_mae_dtheta": 0.05803144723176956,
      "pose_mae_dx": 0.020614396780729294,
      "pose_mae_dy": 0.02430945821106434,
      "pose_rmse_dtheta": 0.13582754135131836,
      "pose_rmse_dx": 0.05543883144855499,
      "pose_rmse_dy": 0.05578870698809624,
      "pose_rmse_mean": 0.0823516994714737,
      "rmse_dtheta": 0.020243095234036446,
      "rmse_dx": 0.00579351931810379,
      "rmse_dy": 0.004009596072137356,
      "rmse_mean": 0.010015403851866722,
      "rotation_flip": 0.005624748766422272,
      "sparse_tokens": 32105.0,
      "step": 11325,
      "turn_loss": 0.08041274547576904,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.526203307935328,
      "grad_norm": 0.45740461349487305,
      "learning_rate": 7.944397831941952e-08,
      "loss": 0.0945,
      "mae_dtheta": 0.010672657750546932,
      "mae_dx": 0.002173100132495165,
      "mae_dy": 0.0020219250582158566,
      "pose_mae_dtheta": 0.07763832807540894,
      "pose_mae_dx": 0.02198352850973606,
      "pose_mae_dy": 0.025172624737024307,
      "pose_rmse_dtheta": 0.22836753726005554,
      "pose_rmse_dx": 0.062350958585739136,
      "pose_rmse_dy": 0.07465606182813644,
      "pose_rmse_mean": 0.1217915266752243,
      "rmse_dtheta": 0.026587767526507378,
      "rmse_dx": 0.0064402357675135136,
      "rmse_dy": 0.005289852153509855,
      "rmse_mean": 0.012772618792951107,
      "rotation_flip": 0.006529850885272026,
      "sparse_tokens": 32153.0,
      "step": 11326,
      "turn_loss": 0.08233103901147842,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5262497677011708,
      "grad_norm": 0.631233274936676,
      "learning_rate": 7.920938613798446e-08,
      "loss": 0.1412,
      "mae_dtheta": 0.00871948804706335,
      "mae_dx": 0.0013644625432789326,
      "mae_dy": 0.0017072850605472922,
      "pose_mae_dtheta": 0.05750935524702072,
      "pose_mae_dx": 0.015603318810462952,
      "pose_mae_dy": 0.017518382519483566,
      "pose_rmse_dtheta": 0.2104043960571289,
      "pose_rmse_dx": 0.04037797823548317,
      "pose_rmse_dy": 0.036912545561790466,
      "pose_rmse_mean": 0.09589831531047821,
      "rmse_dtheta": 0.023455798625946045,
      "rmse_dx": 0.0036875407677143812,
      "rmse_dy": 0.0038286151830106974,
      "rmse_mean": 0.010323984548449516,
      "rotation_flip": 0.0054367524571716785,
      "sparse_tokens": 32121.0,
      "step": 11327,
      "turn_loss": 0.0673273354768753,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5262962274670135,
      "grad_norm": 0.4694870710372925,
      "learning_rate": 7.897513807007762e-08,
      "loss": 0.1119,
      "mae_dtheta": 0.008632308803498745,
      "mae_dx": 0.001501941354945302,
      "mae_dy": 0.002138440264388919,
      "pose_mae_dtheta": 0.05796234309673309,
      "pose_mae_dx": 0.01952291466295719,
      "pose_mae_dy": 0.02213262766599655,
      "pose_rmse_dtheta": 0.14024804532527924,
      "pose_rmse_dx": 0.04911144822835922,
      "pose_rmse_dy": 0.05183282494544983,
      "pose_rmse_mean": 0.08039744198322296,
      "rmse_dtheta": 0.019806994125247,
      "rmse_dx": 0.00422380305826664,
      "rmse_dy": 0.005322989542037249,
      "rmse_mean": 0.009784596040844917,
      "rotation_flip": 0.00368139217607677,
      "sparse_tokens": 32185.0,
      "step": 11328,
      "turn_loss": 0.07598064094781876,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5263426872328564,
      "grad_norm": 0.47295090556144714,
      "learning_rate": 7.874123413208145e-08,
      "loss": 0.0948,
      "mae_dtheta": 0.007991432212293148,
      "mae_dx": 0.0014736467273905873,
      "mae_dy": 0.0019536190666258335,
      "pose_mae_dtheta": 0.050866857171058655,
      "pose_mae_dx": 0.020312560722231865,
      "pose_mae_dy": 0.02415703982114792,
      "pose_rmse_dtheta": 0.09986106306314468,
      "pose_rmse_dx": 0.05733910948038101,
      "pose_rmse_dy": 0.05602600425481796,
      "pose_rmse_mean": 0.07107539474964142,
      "rmse_dtheta": 0.016269581392407417,
      "rmse_dx": 0.004783611744642258,
      "rmse_dy": 0.004272970370948315,
      "rmse_mean": 0.008442054502665997,
      "rotation_flip": 0.0020929258316755295,
      "sparse_tokens": 32105.0,
      "step": 11329,
      "turn_loss": 0.08119796216487885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.5263891469986991,
      "grad_norm": 0.5628787875175476,
      "learning_rate": 7.850767434035179e-08,
      "loss": 0.0974,
      "mae_dtheta": 0.0457753948867321,
      "mae_dx": 0.009875827468931675,
      "mae_dy": 0.005413902457803488,
      "pose_mae_dtheta": 0.37038835883140564,
      "pose_mae_dx": 0.0699697881937027,
      "pose_mae_dy": 0.06669444590806961,
      "pose_rmse_dtheta": 0.671158492565155,
      "pose_rmse_dx": 0.18830376863479614,
      "pose_rmse_dy": 0.14527562260627747,
      "pose_rmse_mean": 0.33491262793540955,
      "rmse_dtheta": 0.06882504373788834,
      "rmse_dx": 0.022352268919348717,
      "rmse_dy": 0.009716070257127285,
      "rmse_mean": 0.033631131052970886,
      "rotation_flip": 0.0032362460624426603,
      "sparse_tokens": 6618.0,
      "step": 11330,
      "turn_loss": 0.3279135227203369,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.5264356067645419,
      "grad_norm": 0.6954060792922974,
      "learning_rate": 7.82744587112222e-08,
      "loss": 0.1616,
      "mae_dtheta": 0.038199324160814285,
      "mae_dx": 0.008595029823482037,
      "mae_dy": 0.005599536467343569,
      "pose_mae_dtheta": 0.3128555417060852,
      "pose_mae_dx": 0.06258852034807205,
      "pose_mae_dy": 0.05148714408278465,
      "pose_rmse_dtheta": 0.5870225429534912,
      "pose_rmse_dx": 0.1371668428182602,
      "pose_rmse_dy": 0.13862787187099457,
      "pose_rmse_mean": 0.28760576248168945,
      "rmse_dtheta": 0.06241706386208534,
      "rmse_dx": 0.01896526664495468,
      "rmse_dy": 0.013581893406808376,
      "rmse_mean": 0.03165474534034729,
      "rotation_flip": 0.015256588347256184,
      "sparse_tokens": 12117.0,
      "step": 11331,
      "turn_loss": 0.2745676636695862,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5264820665303847,
      "grad_norm": 0.49837541580200195,
      "learning_rate": 7.804158726100131e-08,
      "loss": 0.1283,
      "mae_dtheta": 0.011501701548695564,
      "mae_dx": 0.0024147869553416967,
      "mae_dy": 0.0034640668891370296,
      "pose_mae_dtheta": 0.0803467184305191,
      "pose_mae_dx": 0.02520163170993328,
      "pose_mae_dy": 0.028976192697882652,
      "pose_rmse_dtheta": 0.20824134349822998,
      "pose_rmse_dx": 0.061367109417915344,
      "pose_rmse_dy": 0.06406693905591965,
      "pose_rmse_mean": 0.11122512817382812,
      "rmse_dtheta": 0.025055723264813423,
      "rmse_dx": 0.0077148242853581905,
      "rmse_dy": 0.00851206574589014,
      "rmse_mean": 0.01376087125390768,
      "rotation_flip": 0.006473594345152378,
      "sparse_tokens": 32121.0,
      "step": 11332,
      "turn_loss": 0.1123504713177681,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5265285262962275,
      "grad_norm": 0.5037108659744263,
      "learning_rate": 7.780906000597444e-08,
      "loss": 0.1346,
      "mae_dtheta": 0.00896628387272358,
      "mae_dx": 0.0015201534843072295,
      "mae_dy": 0.0020239166915416718,
      "pose_mae_dtheta": 0.059586551040410995,
      "pose_mae_dx": 0.016508543863892555,
      "pose_mae_dy": 0.02319626323878765,
      "pose_rmse_dtheta": 0.16097989678382874,
      "pose_rmse_dx": 0.05393366515636444,
      "pose_rmse_dy": 0.0641564428806305,
      "pose_rmse_mean": 0.09302334487438202,
      "rmse_dtheta": 0.020006733015179634,
      "rmse_dx": 0.004938178695738316,
      "rmse_dy": 0.005431369878351688,
      "rmse_mean": 0.010125427506864071,
      "rotation_flip": 0.0011797089828178287,
      "sparse_tokens": 32105.0,
      "step": 11333,
      "turn_loss": 0.07703948020935059,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.5265749860620702,
      "grad_norm": 0.6640508770942688,
      "learning_rate": 7.757687696240079e-08,
      "loss": 0.1374,
      "mae_dtheta": 0.03185098618268967,
      "mae_dx": 0.02214798703789711,
      "mae_dy": 0.01121161226183176,
      "pose_mae_dtheta": 0.26176220178604126,
      "pose_mae_dx": 0.17863529920578003,
      "pose_mae_dy": 0.14373666048049927,
      "pose_rmse_dtheta": 0.3906145393848419,
      "pose_rmse_dx": 0.33425095677375793,
      "pose_rmse_dy": 0.22920143604278564,
      "pose_rmse_mean": 0.31802231073379517,
      "rmse_dtheta": 0.04259360209107399,
      "rmse_dx": 0.03803259879350662,
      "rmse_dy": 0.017246950417757034,
      "rmse_mean": 0.03262438625097275,
      "rotation_flip": 0.004807692486792803,
      "sparse_tokens": 4227.0,
      "step": 11334,
      "turn_loss": 0.38385868072509766,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 24263.0,
      "epoch": 0.526621445827913,
      "grad_norm": 0.5696291327476501,
      "learning_rate": 7.734503814651906e-08,
      "loss": 0.1239,
      "mae_dtheta": 0.03173463046550751,
      "mae_dx": 0.007007576525211334,
      "mae_dy": 0.0044267671182751656,
      "pose_mae_dtheta": 0.24871468544006348,
      "pose_mae_dx": 0.06042952463030815,
      "pose_mae_dy": 0.06362108141183853,
      "pose_rmse_dtheta": 0.4642922878265381,
      "pose_rmse_dx": 0.14390447735786438,
      "pose_rmse_dy": 0.13502389192581177,
      "pose_rmse_mean": 0.24774020910263062,
      "rmse_dtheta": 0.05065414309501648,
      "rmse_dx": 0.017046330496668816,
      "rmse_dy": 0.007819319143891335,
      "rmse_mean": 0.025173265486955643,
      "rotation_flip": 0.009718173183500767,
      "sparse_tokens": 19563.0,
      "step": 11335,
      "turn_loss": 0.1984741985797882,
      "turns": 75.0,
      "turns_per_sample": 75.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5266679055937558,
      "grad_norm": 0.43912914395332336,
      "learning_rate": 7.711354357454071e-08,
      "loss": 0.1175,
      "mae_dtheta": 0.010674438439309597,
      "mae_dx": 0.0014277290320023894,
      "mae_dy": 0.0016612171893939376,
      "pose_mae_dtheta": 0.06949921697378159,
      "pose_mae_dx": 0.0181647390127182,
      "pose_mae_dy": 0.023190688341856003,
      "pose_rmse_dtheta": 0.19548295438289642,
      "pose_rmse_dx": 0.05751616880297661,
      "pose_rmse_dy": 0.05251752957701683,
      "pose_rmse_mean": 0.10183888673782349,
      "rmse_dtheta": 0.02421438880264759,
      "rmse_dx": 0.0050476714968681335,
      "rmse_dy": 0.0036054798401892185,
      "rmse_mean": 0.01095584686845541,
      "rotation_flip": 0.0021486892364919186,
      "sparse_tokens": 32057.0,
      "step": 11336,
      "turn_loss": 0.07662346214056015,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.5267143653595986,
      "grad_norm": 0.7209036350250244,
      "learning_rate": 7.688239326265446e-08,
      "loss": 0.1855,
      "mae_dtheta": 0.029484720900654793,
      "mae_dx": 0.011159618385136127,
      "mae_dy": 0.008328167721629143,
      "pose_mae_dtheta": 0.21083787083625793,
      "pose_mae_dx": 0.09463107585906982,
      "pose_mae_dy": 0.10713856667280197,
      "pose_rmse_dtheta": 0.3994936943054199,
      "pose_rmse_dx": 0.22415392100811005,
      "pose_rmse_dy": 0.24540965259075165,
      "pose_rmse_mean": 0.28968578577041626,
      "rmse_dtheta": 0.046707142144441605,
      "rmse_dx": 0.02610631287097931,
      "rmse_dy": 0.01803874596953392,
      "rmse_mean": 0.03028406761586666,
      "rotation_flip": 0.011396011337637901,
      "sparse_tokens": 18222.0,
      "step": 11337,
      "turn_loss": 0.2821725904941559,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 31466.0,
      "epoch": 0.5267608251254414,
      "grad_norm": 0.5793628692626953,
      "learning_rate": 7.665158722702515e-08,
      "loss": 0.1201,
      "mae_dtheta": 0.031706344336271286,
      "mae_dx": 0.008625611662864685,
      "mae_dy": 0.003965133335441351,
      "pose_mae_dtheta": 0.225285604596138,
      "pose_mae_dx": 0.06596530228853226,
      "pose_mae_dy": 0.04243740439414978,
      "pose_rmse_dtheta": 0.4167339503765106,
      "pose_rmse_dx": 0.1623227894306183,
      "pose_rmse_dy": 0.10630397498607635,
      "pose_rmse_mean": 0.22845357656478882,
      "rmse_dtheta": 0.0509941466152668,
      "rmse_dx": 0.019761493429541588,
      "rmse_dy": 0.008387215435504913,
      "rmse_mean": 0.026380952447652817,
      "rotation_flip": 0.018469657748937607,
      "sparse_tokens": 26112.0,
      "step": 11338,
      "turn_loss": 0.22096213698387146,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5268072848912841,
      "grad_norm": 0.36991435289382935,
      "learning_rate": 7.642112548379266e-08,
      "loss": 0.0615,
      "mae_dtheta": 0.007310736458748579,
      "mae_dx": 0.0013811906101182103,
      "mae_dy": 0.001059561618603766,
      "pose_mae_dtheta": 0.04696730896830559,
      "pose_mae_dx": 0.014449503272771835,
      "pose_mae_dy": 0.014333458617329597,
      "pose_rmse_dtheta": 0.1523561030626297,
      "pose_rmse_dx": 0.040531471371650696,
      "pose_rmse_dy": 0.038137394934892654,
      "pose_rmse_mean": 0.07700832188129425,
      "rmse_dtheta": 0.022034648805856705,
      "rmse_dx": 0.00460747629404068,
      "rmse_dy": 0.002614633645862341,
      "rmse_mean": 0.009752253070473671,
      "rotation_flip": 0.0022361360024660826,
      "sparse_tokens": 32169.0,
      "step": 11339,
      "turn_loss": 0.056129999458789825,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.526853744657127,
      "grad_norm": 0.4455718398094177,
      "learning_rate": 7.619100804907353e-08,
      "loss": 0.1003,
      "mae_dtheta": 0.00889988150447607,
      "mae_dx": 0.0016882565105333924,
      "mae_dy": 0.0009225811227224767,
      "pose_mae_dtheta": 0.061171673238277435,
      "pose_mae_dx": 0.014550238847732544,
      "pose_mae_dy": 0.013458006083965302,
      "pose_rmse_dtheta": 0.20212671160697937,
      "pose_rmse_dx": 0.03953692689538002,
      "pose_rmse_dy": 0.03661293908953667,
      "pose_rmse_mean": 0.09275885671377182,
      "rmse_dtheta": 0.024909691885113716,
      "rmse_dx": 0.005724610295146704,
      "rmse_dy": 0.0022167640272527933,
      "rmse_mean": 0.010950355790555477,
      "rotation_flip": 0.004124926403164864,
      "sparse_tokens": 32121.0,
      "step": 11340,
      "turn_loss": 0.07298742234706879,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5269002044229697,
      "grad_norm": 0.4227454662322998,
      "learning_rate": 7.59612349389599e-08,
      "loss": 0.1197,
      "mae_dtheta": 0.008564459159970284,
      "mae_dx": 0.0011186613701283932,
      "mae_dy": 0.0018896508263424039,
      "pose_mae_dtheta": 0.05780324339866638,
      "pose_mae_dx": 0.01721409149467945,
      "pose_mae_dy": 0.02367471158504486,
      "pose_rmse_dtheta": 0.15690714120864868,
      "pose_rmse_dx": 0.04702705144882202,
      "pose_rmse_dy": 0.05652772635221481,
      "pose_rmse_mean": 0.08682064712047577,
      "rmse_dtheta": 0.01849326677620411,
      "rmse_dx": 0.003294430673122406,
      "rmse_dy": 0.004323416389524937,
      "rmse_mean": 0.008703704923391342,
      "rotation_flip": 0.007241129409521818,
      "sparse_tokens": 32105.0,
      "step": 11341,
      "turn_loss": 0.06813835352659225,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.5269466641888125,
      "grad_norm": 0.6306559443473816,
      "learning_rate": 7.573180616952003e-08,
      "loss": 0.127,
      "mae_dtheta": 0.024792898446321487,
      "mae_dx": 0.012290078215301037,
      "mae_dy": 0.0034283993300050497,
      "pose_mae_dtheta": 0.18671473860740662,
      "pose_mae_dx": 0.09869782626628876,
      "pose_mae_dy": 0.03741823881864548,
      "pose_rmse_dtheta": 0.3383214473724365,
      "pose_rmse_dx": 0.22428497672080994,
      "pose_rmse_dy": 0.10010469704866409,
      "pose_rmse_mean": 0.22090372443199158,
      "rmse_dtheta": 0.039683997631073,
      "rmse_dx": 0.02448931336402893,
      "rmse_dy": 0.006703360937535763,
      "rmse_mean": 0.023625558242201805,
      "rotation_flip": 0.00918484479188919,
      "sparse_tokens": 14688.0,
      "step": 11342,
      "turn_loss": 0.16815346479415894,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.5269931239546553,
      "grad_norm": 0.40382274985313416,
      "learning_rate": 7.55027217567983e-08,
      "loss": 0.1082,
      "mae_dtheta": 0.021323956549167633,
      "mae_dx": 0.008107361383736134,
      "mae_dy": 0.003289749613031745,
      "pose_mae_dtheta": 0.16883747279644012,
      "pose_mae_dx": 0.06826651841402054,
      "pose_mae_dy": 0.03210363909602165,
      "pose_rmse_dtheta": 0.2933281362056732,
      "pose_rmse_dx": 0.16068942844867706,
      "pose_rmse_dy": 0.06201345473527908,
      "pose_rmse_mean": 0.17201034724712372,
      "rmse_dtheta": 0.03743813931941986,
      "rmse_dx": 0.01866496168076992,
      "rmse_dy": 0.006053437013179064,
      "rmse_mean": 0.02071884647011757,
      "rotation_flip": 0.022284122183918953,
      "sparse_tokens": 7674.0,
      "step": 11343,
      "turn_loss": 0.23705412447452545,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 19155.0,
      "epoch": 0.5270395837204981,
      "grad_norm": 0.8538362383842468,
      "learning_rate": 7.527398171681354e-08,
      "loss": 0.2452,
      "mae_dtheta": 0.027801426127552986,
      "mae_dx": 0.006933311000466347,
      "mae_dy": 0.006018232088536024,
      "pose_mae_dtheta": 0.1919887363910675,
      "pose_mae_dx": 0.04887791723012924,
      "pose_mae_dy": 0.07355785369873047,
      "pose_rmse_dtheta": 0.37346357107162476,
      "pose_rmse_dx": 0.12720657885074615,
      "pose_rmse_dy": 0.18637196719646454,
      "pose_rmse_mean": 0.22901403903961182,
      "rmse_dtheta": 0.045004088431596756,
      "rmse_dx": 0.017138106748461723,
      "rmse_dy": 0.011451778002083302,
      "rmse_mean": 0.024531325325369835,
      "rotation_flip": 0.013978494331240654,
      "sparse_tokens": 15002.0,
      "step": 11344,
      "turn_loss": 0.23545025289058685,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5270860434863408,
      "grad_norm": 0.38756054639816284,
      "learning_rate": 7.5045586065563e-08,
      "loss": 0.0877,
      "mae_dtheta": 0.010676172561943531,
      "mae_dx": 0.0016515111783519387,
      "mae_dy": 0.00226244842633605,
      "pose_mae_dtheta": 0.06816456466913223,
      "pose_mae_dx": 0.017771415412425995,
      "pose_mae_dy": 0.02759130671620369,
      "pose_rmse_dtheta": 0.14259938895702362,
      "pose_rmse_dx": 0.04321480542421341,
      "pose_rmse_dy": 0.058134231716394424,
      "pose_rmse_mean": 0.08131614327430725,
      "rmse_dtheta": 0.020078666508197784,
      "rmse_dx": 0.005396696738898754,
      "rmse_dy": 0.0047041261568665504,
      "rmse_mean": 0.01005982980132103,
      "rotation_flip": 0.005780346691608429,
      "sparse_tokens": 32105.0,
      "step": 11345,
      "turn_loss": 0.08641420304775238,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.5271325032521836,
      "grad_norm": 0.3620666265487671,
      "learning_rate": 7.481753481901832e-08,
      "loss": 0.0749,
      "mae_dtheta": 0.03404879942536354,
      "mae_dx": 0.012092058546841145,
      "mae_dy": 0.006283117458224297,
      "pose_mae_dtheta": 0.25362780690193176,
      "pose_mae_dx": 0.10876426845788956,
      "pose_mae_dy": 0.05250366032123566,
      "pose_rmse_dtheta": 0.43993574380874634,
      "pose_rmse_dx": 0.20202521979808807,
      "pose_rmse_dy": 0.12028369307518005,
      "pose_rmse_mean": 0.2540815770626068,
      "rmse_dtheta": 0.05078252777457237,
      "rmse_dx": 0.02141859382390976,
      "rmse_dy": 0.013419055379927158,
      "rmse_mean": 0.028540058061480522,
      "rotation_flip": 0.011441648006439209,
      "sparse_tokens": 6200.0,
      "step": 11346,
      "turn_loss": 0.28247401118278503,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5271789630180264,
      "grad_norm": 0.3955751955509186,
      "learning_rate": 7.458982799312676e-08,
      "loss": 0.0958,
      "mae_dtheta": 0.007900831289589405,
      "mae_dx": 0.0011147521436214447,
      "mae_dy": 0.0018316442146897316,
      "pose_mae_dtheta": 0.054052967578172684,
      "pose_mae_dx": 0.01780301332473755,
      "pose_mae_dy": 0.023500900715589523,
      "pose_rmse_dtheta": 0.17117135226726532,
      "pose_rmse_dx": 0.04555497318506241,
      "pose_rmse_dy": 0.05585440620779991,
      "pose_rmse_mean": 0.09086024761199951,
      "rmse_dtheta": 0.02029116451740265,
      "rmse_dx": 0.0030526428017765284,
      "rmse_dy": 0.004139373078942299,
      "rmse_mean": 0.00916106067597866,
      "rotation_flip": 0.0014354067388921976,
      "sparse_tokens": 32073.0,
      "step": 11347,
      "turn_loss": 0.06873669475317001,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5272254227838692,
      "grad_norm": 0.7413484454154968,
      "learning_rate": 7.436246560381222e-08,
      "loss": 0.1741,
      "mae_dtheta": 0.008366940543055534,
      "mae_dx": 0.0011547640897333622,
      "mae_dy": 0.0012748604640364647,
      "pose_mae_dtheta": 0.0546301007270813,
      "pose_mae_dx": 0.012975765392184258,
      "pose_mae_dy": 0.01769166812300682,
      "pose_rmse_dtheta": 0.1682787835597992,
      "pose_rmse_dx": 0.03399071842432022,
      "pose_rmse_dy": 0.047856654971838,
      "pose_rmse_mean": 0.08337538689374924,
      "rmse_dtheta": 0.021261636167764664,
      "rmse_dx": 0.0039497241377830505,
      "rmse_dy": 0.0027719230856746435,
      "rmse_mean": 0.009327761828899384,
      "rotation_flip": 0.0008525149314664304,
      "sparse_tokens": 32137.0,
      "step": 11348,
      "turn_loss": 0.061303313821554184,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.5272718825497119,
      "grad_norm": 0.6156322360038757,
      "learning_rate": 7.413544766697368e-08,
      "loss": 0.1241,
      "mae_dtheta": 0.03261154890060425,
      "mae_dx": 0.008401941508054733,
      "mae_dy": 0.004743281751871109,
      "pose_mae_dtheta": 0.23396629095077515,
      "pose_mae_dx": 0.06727952510118484,
      "pose_mae_dy": 0.06378865242004395,
      "pose_rmse_dtheta": 0.44247013330459595,
      "pose_rmse_dx": 0.14363552629947662,
      "pose_rmse_dy": 0.19786213338375092,
      "pose_rmse_mean": 0.26132261753082275,
      "rmse_dtheta": 0.0510624535381794,
      "rmse_dx": 0.019252652302384377,
      "rmse_dy": 0.010333343409001827,
      "rmse_mean": 0.026882817968726158,
      "rotation_flip": 0.023357663303613663,
      "sparse_tokens": 11180.0,
      "step": 11349,
      "turn_loss": 0.23139123618602753,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 21098.0,
      "epoch": 0.5273183423155547,
      "grad_norm": 0.41809242963790894,
      "learning_rate": 7.390877419848786e-08,
      "loss": 0.1105,
      "mae_dtheta": 0.029328742995858192,
      "mae_dx": 0.009446380659937859,
      "mae_dy": 0.004949379246681929,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4180924892425537,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.48646545410156,
      "model/head/act_norm_mean": 104.89948167067308,
      "model/head/act_norm_min": 73.43429565429688,
      "model/head/act_over_embed": 72.08790588850694,
      "model/head/grad_frac": 0.11312617361545563,
      "model/head/grad_norm": 0.04729720205068588,
      "model/head/grad_zero_frac": 0.00020337120804470032,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6963491586538462,
      "model/head/update_ratio": 0.0008051299373619258,
      "model/head/weight_delta": 9.984880447387695,
      "model/head/weight_delta_rel": 0.1751643717288971,
      "model/head/weight_norm": 58.74480438232422,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229383170604706,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42286702358361444,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42280399799346924,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905981775501088,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09253014624118805,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03868615999817848,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5291785037878788,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012491557281464338,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1565427780151367,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313408821821213,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969846725463867,
      "model/modality_embedder/grad_frac": 0.09253014624118805,
      "model/modality_embedder/grad_norm": 0.03868615999817848,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5291785037878788,
      "model/modality_embedder/update_ratio": 0.0012491557281464338,
      "model/modality_embedder/weight_delta": 3.1565427780151367,
      "model/modality_embedder/weight_delta_rel": 0.10313408821821213,
      "model/modality_embedder/weight_norm": 30.969846725463867,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.78177642822266,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.13914262820513,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.171978950500488,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.901435446168943,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.060807965695858,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.025423353537917137,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009092388791032135,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.742220878601074,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09992818534374237,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961137771606445,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.3963851928711,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.96277090964591,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.81725025177002,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.46744051210451,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06196439266204834,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.025906847789883614,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008702121558599174,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.476764440536499,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12043783813714981,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77072525024414,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.2086410522461,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.57702228327228,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.055848121643066,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.576769168920016,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.061322495341300964,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02563847415149212,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008339796913787723,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7666842937469482,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12647821009159088,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742324829101562,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.9501953125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.440445665445665,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.13563346862793,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.85733116279413,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06731903553009033,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02814558334648609,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.000939577235840261,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2378222942352295,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11065340042114258,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955581665039062,
      "model/normalizer/grad_frac": 0.2314091920852661,
      "model/normalizer/grad_norm": 0.09675044566392899,
      "model/normalizer/grad_zero_frac": 0.0002458015806041658,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0012300157686695457,
      "model/normalizer/weight_delta": 6.809072017669678,
      "model/normalizer/weight_delta_rel": 0.08769690245389938,
      "model/normalizer/weight_norm": 78.65789031982422,
      "pose_mae_dtheta": 0.201595738530159,
      "pose_mae_dx": 0.07373380661010742,
      "pose_mae_dy": 0.06318936496973038,
      "pose_rmse_dtheta": 0.3665723204612732,
      "pose_rmse_dx": 0.18991723656654358,
      "pose_rmse_dy": 0.13684579730033875,
      "pose_rmse_mean": 0.2311118096113205,
      "rmse_dtheta": 0.0459689237177372,
      "rmse_dx": 0.022510964423418045,
      "rmse_dy": 0.009964196011424065,
      "rmse_mean": 0.026148028671741486,
      "rotation_flip": 0.011246485635638237,
      "sparse_tokens": 16896.0,
      "step": 11350,
      "turn_loss": 0.24119709432125092,
      "turns": 65.0,
      "turns_per_sample": 65.0
    },
    {
      "dense_tokens": 25879.0,
      "epoch": 0.5273648020813975,
      "grad_norm": 0.5706987977027893,
      "learning_rate": 7.368244521420486e-08,
      "loss": 0.1321,
      "mae_dtheta": 0.028447264805436134,
      "mae_dx": 0.009097093716263771,
      "mae_dy": 0.004255206789821386,
      "pose_mae_dtheta": 0.21470403671264648,
      "pose_mae_dx": 0.07058515399694443,
      "pose_mae_dy": 0.06478128582239151,
      "pose_rmse_dtheta": 0.40791407227516174,
      "pose_rmse_dx": 0.17282341420650482,
      "pose_rmse_dy": 0.15065957605838776,
      "pose_rmse_mean": 0.24379901587963104,
      "rmse_dtheta": 0.047644007951021194,
      "rmse_dx": 0.02142247185111046,
      "rmse_dy": 0.008488048799335957,
      "rmse_mean": 0.02585151046514511,
      "rotation_flip": 0.0073059359565377235,
      "sparse_tokens": 21174.0,
      "step": 11351,
      "turn_loss": 0.2266637086868286,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.5274112618472403,
      "grad_norm": 0.5849210619926453,
      "learning_rate": 7.345646072995316e-08,
      "loss": 0.1573,
      "mae_dtheta": 0.027946526184678078,
      "mae_dx": 0.009048142470419407,
      "mae_dy": 0.002871116856113076,
      "pose_mae_dtheta": 0.21255649626255035,
      "pose_mae_dx": 0.08759116381406784,
      "pose_mae_dy": 0.027982350438833237,
      "pose_rmse_dtheta": 0.42918694019317627,
      "pose_rmse_dx": 0.20031072199344635,
      "pose_rmse_dy": 0.07140477746725082,
      "pose_rmse_mean": 0.23363414406776428,
      "rmse_dtheta": 0.04676230624318123,
      "rmse_dx": 0.020295683294534683,
      "rmse_dy": 0.005804833956062794,
      "rmse_mean": 0.02428760938346386,
      "rotation_flip": 0.009244992397725582,
      "sparse_tokens": 12615.0,
      "step": 11352,
      "turn_loss": 0.15956199169158936,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.527457721613083,
      "grad_norm": 0.5654757618904114,
      "learning_rate": 7.32308207615351e-08,
      "loss": 0.1713,
      "mae_dtheta": 0.010551145300269127,
      "mae_dx": 0.001978878164663911,
      "mae_dy": 0.003033882472664118,
      "pose_mae_dtheta": 0.0667891874909401,
      "pose_mae_dx": 0.023699643090367317,
      "pose_mae_dy": 0.025436963886022568,
      "pose_rmse_dtheta": 0.1555960327386856,
      "pose_rmse_dx": 0.06074323505163193,
      "pose_rmse_dy": 0.060898032039403915,
      "pose_rmse_mean": 0.09241243451833725,
      "rmse_dtheta": 0.023565568029880524,
      "rmse_dx": 0.0049484181217849255,
      "rmse_dy": 0.006673264317214489,
      "rmse_mean": 0.011729083955287933,
      "rotation_flip": 0.0034854246769100428,
      "sparse_tokens": 32169.0,
      "step": 11353,
      "turn_loss": 0.08503036946058273,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2946.0,
      "epoch": 0.5275041813789259,
      "grad_norm": 1.821070671081543,
      "learning_rate": 7.30055253247297e-08,
      "loss": 0.2817,
      "mae_dtheta": 0.060811031609773636,
      "mae_dx": 0.012858642265200615,
      "mae_dy": 0.02033562958240509,
      "pose_mae_dtheta": 0.5149035453796387,
      "pose_mae_dx": 0.1299239993095398,
      "pose_mae_dy": 0.19729773700237274,
      "pose_rmse_dtheta": 0.7385711073875427,
      "pose_rmse_dx": 0.22934724390506744,
      "pose_rmse_dy": 0.36055535078048706,
      "pose_rmse_mean": 0.4428245723247528,
      "rmse_dtheta": 0.07437331229448318,
      "rmse_dx": 0.022869359701871872,
      "rmse_dy": 0.03177312761545181,
      "rmse_mean": 0.04300526902079582,
      "rotation_flip": 0.019480518996715546,
      "sparse_tokens": 2470.0,
      "step": 11354,
      "turn_loss": 0.533463180065155,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5275506411447687,
      "grad_norm": 0.2996944189071655,
      "learning_rate": 7.27805744352933e-08,
      "loss": 0.0692,
      "mae_dtheta": 0.008804583922028542,
      "mae_dx": 0.0016192172188311815,
      "mae_dy": 0.0018834351794794202,
      "pose_mae_dtheta": 0.05572641268372536,
      "pose_mae_dx": 0.01975269429385662,
      "pose_mae_dy": 0.02239159494638443,
      "pose_rmse_dtheta": 0.1433948576450348,
      "pose_rmse_dx": 0.05359435826539993,
      "pose_rmse_dy": 0.053156349807977676,
      "pose_rmse_mean": 0.08338185399770737,
      "rmse_dtheta": 0.020269477739930153,
      "rmse_dx": 0.005221371538937092,
      "rmse_dy": 0.004125010687857866,
      "rmse_mean": 0.00987195409834385,
      "rotation_flip": 0.005256241653114557,
      "sparse_tokens": 32105.0,
      "step": 11355,
      "turn_loss": 0.07132700830698013,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5275971009106114,
      "grad_norm": 0.468982458114624,
      "learning_rate": 7.255596810895548e-08,
      "loss": 0.0868,
      "mae_dtheta": 0.01165229082107544,
      "mae_dx": 0.002489992417395115,
      "mae_dy": 0.0036629443056881428,
      "pose_mae_dtheta": 0.08029962331056595,
      "pose_mae_dx": 0.022077785804867744,
      "pose_mae_dy": 0.03511282056570053,
      "pose_rmse_dtheta": 0.23364579677581787,
      "pose_rmse_dx": 0.06593257188796997,
      "pose_rmse_dy": 0.09905117005109787,
      "pose_rmse_mean": 0.13287651538848877,
      "rmse_dtheta": 0.0287203099578619,
      "rmse_dx": 0.0072809322737157345,
      "rmse_dy": 0.009409552440047264,
      "rmse_mean": 0.015136932954192162,
      "rotation_flip": 0.010421008802950382,
      "sparse_tokens": 32089.0,
      "step": 11356,
      "turn_loss": 0.1112416684627533,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36989.0,
      "epoch": 0.5276435606764542,
      "grad_norm": 0.44764190912246704,
      "learning_rate": 7.233170636142373e-08,
      "loss": 0.1424,
      "mae_dtheta": 0.03605911508202553,
      "mae_dx": 0.007692563813179731,
      "mae_dy": 0.003706271294504404,
      "pose_mae_dtheta": 0.25824326276779175,
      "pose_mae_dx": 0.06817174702882767,
      "pose_mae_dy": 0.04376493766903877,
      "pose_rmse_dtheta": 0.45493724942207336,
      "pose_rmse_dx": 0.15450580418109894,
      "pose_rmse_dy": 0.11206074059009552,
      "pose_rmse_mean": 0.240501269698143,
      "rmse_dtheta": 0.054955847561359406,
      "rmse_dx": 0.01791086606681347,
      "rmse_dy": 0.00785756204277277,
      "rmse_mean": 0.026908092200756073,
      "rotation_flip": 0.016245488077402115,
      "sparse_tokens": 27363.0,
      "step": 11357,
      "turn_loss": 0.29846829175949097,
      "turns": 114.0,
      "turns_per_sample": 114.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.527690020442297,
      "grad_norm": 0.8066057562828064,
      "learning_rate": 7.210778920837991e-08,
      "loss": 0.14,
      "mae_dtheta": 0.03712134435772896,
      "mae_dx": 0.0044541433453559875,
      "mae_dy": 0.0023573332000523806,
      "pose_mae_dtheta": 0.35383933782577515,
      "pose_mae_dx": 0.046266306191682816,
      "pose_mae_dy": 0.031687263399362564,
      "pose_rmse_dtheta": 0.6105916500091553,
      "pose_rmse_dx": 0.10674857348203659,
      "pose_rmse_dy": 0.09354960173368454,
      "pose_rmse_mean": 0.2702966332435608,
      "rmse_dtheta": 0.05969062075018883,
      "rmse_dx": 0.010338599793612957,
      "rmse_dy": 0.005034155212342739,
      "rmse_mean": 0.025021126493811607,
      "rotation_flip": 0.016949152573943138,
      "sparse_tokens": 4916.0,
      "step": 11358,
      "turn_loss": 0.2245926856994629,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.5277364802081398,
      "grad_norm": 0.6176466941833496,
      "learning_rate": 7.188421666548373e-08,
      "loss": 0.1409,
      "mae_dtheta": 0.014100205153226852,
      "mae_dx": 0.009807801805436611,
      "mae_dy": 0.002533701481297612,
      "pose_mae_dtheta": 0.0943937823176384,
      "pose_mae_dx": 0.06803017854690552,
      "pose_mae_dy": 0.030742013826966286,
      "pose_rmse_dtheta": 0.17085255682468414,
      "pose_rmse_dx": 0.180376335978508,
      "pose_rmse_dy": 0.08289530128240585,
      "pose_rmse_mean": 0.1447080671787262,
      "rmse_dtheta": 0.02502043917775154,
      "rmse_dx": 0.023073595017194748,
      "rmse_dy": 0.005317320115864277,
      "rmse_mean": 0.01780378445982933,
      "rotation_flip": 0.005780346691608429,
      "sparse_tokens": 5903.0,
      "step": 11359,
      "turn_loss": 0.11581035703420639,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.5277829399739825,
      "grad_norm": 1.247938632965088,
      "learning_rate": 7.16609887483699e-08,
      "loss": 0.2668,
      "mae_dtheta": 0.03398393094539642,
      "mae_dx": 0.015890788286924362,
      "mae_dy": 0.006493384949862957,
      "pose_mae_dtheta": 0.24992598593235016,
      "pose_mae_dx": 0.09298400580883026,
      "pose_mae_dy": 0.09291793406009674,
      "pose_rmse_dtheta": 0.41048523783683777,
      "pose_rmse_dx": 0.1804845631122589,
      "pose_rmse_dy": 0.22119355201721191,
      "pose_rmse_mean": 0.2707211375236511,
      "rmse_dtheta": 0.05243748798966408,
      "rmse_dx": 0.027813194319605827,
      "rmse_dy": 0.01250556018203497,
      "rmse_mean": 0.030918747186660767,
      "rotation_flip": 0.010282776318490505,
      "sparse_tokens": 6354.0,
      "step": 11360,
      "turn_loss": 0.24954116344451904,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.5278293997398253,
      "grad_norm": 0.5803731083869934,
      "learning_rate": 7.143810547264762e-08,
      "loss": 0.174,
      "mae_dtheta": 0.0286419615149498,
      "mae_dx": 0.008833198808133602,
      "mae_dy": 0.005372040905058384,
      "pose_mae_dtheta": 0.20909017324447632,
      "pose_mae_dx": 0.06560023128986359,
      "pose_mae_dy": 0.06421579420566559,
      "pose_rmse_dtheta": 0.39149436354637146,
      "pose_rmse_dx": 0.16918839514255524,
      "pose_rmse_dy": 0.15998432040214539,
      "pose_rmse_mean": 0.24022237956523895,
      "rmse_dtheta": 0.04649260267615318,
      "rmse_dx": 0.02075476199388504,
      "rmse_dy": 0.012003200128674507,
      "rmse_mean": 0.026416853070259094,
      "rotation_flip": 0.017412934452295303,
      "sparse_tokens": 6533.0,
      "step": 11361,
      "turn_loss": 0.2668437957763672,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5278758595056681,
      "grad_norm": 0.3561936020851135,
      "learning_rate": 7.12155668539044e-08,
      "loss": 0.0815,
      "mae_dtheta": 0.012435957789421082,
      "mae_dx": 0.0023326806258410215,
      "mae_dy": 0.004505801014602184,
      "pose_mae_dtheta": 0.08479882776737213,
      "pose_mae_dx": 0.028715040534734726,
      "pose_mae_dy": 0.038422346115112305,
      "pose_rmse_dtheta": 0.19447191059589386,
      "pose_rmse_dx": 0.06686733663082123,
      "pose_rmse_dy": 0.08085799217224121,
      "pose_rmse_mean": 0.1140657514333725,
      "rmse_dtheta": 0.02585930936038494,
      "rmse_dx": 0.005914523731917143,
      "rmse_dy": 0.009725922718644142,
      "rmse_mean": 0.013833252713084221,
      "rotation_flip": 0.006320692133158445,
      "sparse_tokens": 32089.0,
      "step": 11362,
      "turn_loss": 0.12635013461112976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5279223192715109,
      "grad_norm": 0.4479929804801941,
      "learning_rate": 7.09933729077017e-08,
      "loss": 0.0905,
      "mae_dtheta": 0.005921168252825737,
      "mae_dx": 0.0007662074058316648,
      "mae_dy": 0.0011694066924974322,
      "pose_mae_dtheta": 0.037800054997205734,
      "pose_mae_dx": 0.01000156719237566,
      "pose_mae_dy": 0.01780139096081257,
      "pose_rmse_dtheta": 0.08778786659240723,
      "pose_rmse_dx": 0.025898711755871773,
      "pose_rmse_dy": 0.04179694131016731,
      "pose_rmse_mean": 0.05182784050703049,
      "rmse_dtheta": 0.01352647040039301,
      "rmse_dx": 0.0024335274938493967,
      "rmse_dy": 0.0024753757752478123,
      "rmse_mean": 0.006145124789327383,
      "rotation_flip": 0.004277566447854042,
      "sparse_tokens": 32057.0,
      "step": 11363,
      "turn_loss": 0.045224547386169434,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5279687790373536,
      "grad_norm": 0.4502308666706085,
      "learning_rate": 7.077152364957818e-08,
      "loss": 0.1167,
      "mae_dtheta": 0.009046442806720734,
      "mae_dx": 0.002255605300888419,
      "mae_dy": 0.002713541965931654,
      "pose_mae_dtheta": 0.06393387913703918,
      "pose_mae_dx": 0.022430768236517906,
      "pose_mae_dy": 0.030969591811299324,
      "pose_rmse_dtheta": 0.1432730257511139,
      "pose_rmse_dx": 0.06322673708200455,
      "pose_rmse_dy": 0.09203504770994186,
      "pose_rmse_mean": 0.09951160848140717,
      "rmse_dtheta": 0.018246382474899292,
      "rmse_dx": 0.008752528578042984,
      "rmse_dy": 0.006840057205408812,
      "rmse_mean": 0.011279656551778316,
      "rotation_flip": 0.0050847455859184265,
      "sparse_tokens": 32153.0,
      "step": 11364,
      "turn_loss": 0.08573423326015472,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5280152388031965,
      "grad_norm": 0.3918677568435669,
      "learning_rate": 7.055001909504755e-08,
      "loss": 0.0928,
      "mae_dtheta": 0.010145372711122036,
      "mae_dx": 0.0023515629582107067,
      "mae_dy": 0.0028884285129606724,
      "pose_mae_dtheta": 0.06401563435792923,
      "pose_mae_dx": 0.020618002861738205,
      "pose_mae_dy": 0.027014629915356636,
      "pose_rmse_dtheta": 0.13900050520896912,
      "pose_rmse_dx": 0.06096503138542175,
      "pose_rmse_dy": 0.06602755934000015,
      "pose_rmse_mean": 0.08866436779499054,
      "rmse_dtheta": 0.02156544104218483,
      "rmse_dx": 0.007013298571109772,
      "rmse_dy": 0.007643160410225391,
      "rmse_mean": 0.012073966674506664,
      "rotation_flip": 0.008145849220454693,
      "sparse_tokens": 32121.0,
      "step": 11365,
      "turn_loss": 0.10403311252593994,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5280616985690392,
      "grad_norm": 0.44005295634269714,
      "learning_rate": 7.03288592596002e-08,
      "loss": 0.0785,
      "mae_dtheta": 0.006147978827357292,
      "mae_dx": 0.0012824666919186711,
      "mae_dy": 0.0010568748693913221,
      "pose_mae_dtheta": 0.04196016490459442,
      "pose_mae_dx": 0.014006017707288265,
      "pose_mae_dy": 0.017882201820611954,
      "pose_rmse_dtheta": 0.11930433660745621,
      "pose_rmse_dx": 0.04453779757022858,
      "pose_rmse_dy": 0.05277187004685402,
      "pose_rmse_mean": 0.07220467180013657,
      "rmse_dtheta": 0.016931092366576195,
      "rmse_dx": 0.004802578594535589,
      "rmse_dy": 0.0025845624040812254,
      "rmse_mean": 0.008106078021228313,
      "rotation_flip": 0.0026058631483465433,
      "sparse_tokens": 32073.0,
      "step": 11366,
      "turn_loss": 0.04919563606381416,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30077.0,
      "epoch": 0.528108158334882,
      "grad_norm": 0.7990372180938721,
      "learning_rate": 7.010804415870154e-08,
      "loss": 0.1395,
      "mae_dtheta": 0.033259402960538864,
      "mae_dx": 0.010889949277043343,
      "mae_dy": 0.00612244987860322,
      "pose_mae_dtheta": 0.2724386751651764,
      "pose_mae_dx": 0.08775712549686432,
      "pose_mae_dy": 0.07011595368385315,
      "pose_rmse_dtheta": 0.4827464818954468,
      "pose_rmse_dx": 0.2007679045200348,
      "pose_rmse_dy": 0.16559827327728271,
      "pose_rmse_mean": 0.28303754329681396,
      "rmse_dtheta": 0.05120005086064339,
      "rmse_dx": 0.023257017135620117,
      "rmse_dy": 0.013067316263914108,
      "rmse_mean": 0.029174795374274254,
      "rotation_flip": 0.015521064400672913,
      "sparse_tokens": 24698.0,
      "step": 11367,
      "turn_loss": 0.24628692865371704,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 10697.0,
      "epoch": 0.5281546181007247,
      "grad_norm": 0.5402687191963196,
      "learning_rate": 6.98875738077931e-08,
      "loss": 0.1099,
      "mae_dtheta": 0.031969062983989716,
      "mae_dx": 0.012702768668532372,
      "mae_dy": 0.00846189260482788,
      "pose_mae_dtheta": 0.2612619400024414,
      "pose_mae_dx": 0.11674795299768448,
      "pose_mae_dy": 0.1550203412771225,
      "pose_rmse_dtheta": 0.46044278144836426,
      "pose_rmse_dx": 0.23392441868782043,
      "pose_rmse_dy": 0.2820775508880615,
      "pose_rmse_mean": 0.3254815936088562,
      "rmse_dtheta": 0.04854680597782135,
      "rmse_dx": 0.026668788865208626,
      "rmse_dy": 0.013851461932063103,
      "rmse_mean": 0.029689019545912743,
      "rotation_flip": 0.006465517450124025,
      "sparse_tokens": 9253.0,
      "step": 11368,
      "turn_loss": 0.27424734830856323,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5282010778665676,
      "grad_norm": 0.40767115354537964,
      "learning_rate": 6.96674482222931e-08,
      "loss": 0.1046,
      "mae_dtheta": 0.008036332204937935,
      "mae_dx": 0.0013641491532325745,
      "mae_dy": 0.0018841380951926112,
      "pose_mae_dtheta": 0.051943447440862656,
      "pose_mae_dx": 0.01688051037490368,
      "pose_mae_dy": 0.0216533113270998,
      "pose_rmse_dtheta": 0.11971738189458847,
      "pose_rmse_dx": 0.0442194901406765,
      "pose_rmse_dy": 0.05263663828372955,
      "pose_rmse_mean": 0.07219117134809494,
      "rmse_dtheta": 0.01783965900540352,
      "rmse_dx": 0.004451756831258535,
      "rmse_dy": 0.004089420661330223,
      "rmse_mean": 0.008793612942099571,
      "rotation_flip": 0.004510600119829178,
      "sparse_tokens": 32073.0,
      "step": 11369,
      "turn_loss": 0.06203632056713104,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.5282475376324103,
      "grad_norm": 0.6142442226409912,
      "learning_rate": 6.944766741759478e-08,
      "loss": 0.1442,
      "mae_dtheta": 0.027540994808077812,
      "mae_dx": 0.007200752850621939,
      "mae_dy": 0.0032435706816613674,
      "pose_mae_dtheta": 0.20894497632980347,
      "pose_mae_dx": 0.05703989788889885,
      "pose_mae_dy": 0.044367171823978424,
      "pose_rmse_dtheta": 0.43969792127609253,
      "pose_rmse_dx": 0.1272975504398346,
      "pose_rmse_dy": 0.10817569494247437,
      "pose_rmse_mean": 0.22505706548690796,
      "rmse_dtheta": 0.04853164777159691,
      "rmse_dx": 0.016390588134527206,
      "rmse_dy": 0.007083476986736059,
      "rmse_mean": 0.02400190383195877,
      "rotation_flip": 0.010544815100729465,
      "sparse_tokens": 10043.0,
      "step": 11370,
      "turn_loss": 0.18899844586849213,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.5282939973982531,
      "grad_norm": 0.3613990545272827,
      "learning_rate": 6.922823140906754e-08,
      "loss": 0.0945,
      "mae_dtheta": 0.03850699961185455,
      "mae_dx": 0.01070488803088665,
      "mae_dy": 0.004773259628564119,
      "pose_mae_dtheta": 0.29582300782203674,
      "pose_mae_dx": 0.07855315506458282,
      "pose_mae_dy": 0.07214201241731644,
      "pose_rmse_dtheta": 0.5174489617347717,
      "pose_rmse_dx": 0.21229290962219238,
      "pose_rmse_dy": 0.1398979127407074,
      "pose_rmse_mean": 0.2898799180984497,
      "rmse_dtheta": 0.056930359452962875,
      "rmse_dx": 0.02524062991142273,
      "rmse_dy": 0.0076850964687764645,
      "rmse_mean": 0.0299520306289196,
      "rotation_flip": 0.03511705622076988,
      "sparse_tokens": 10352.0,
      "step": 11371,
      "turn_loss": 0.23267659544944763,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.528340457164096,
      "grad_norm": 0.3100042939186096,
      "learning_rate": 6.900914021205574e-08,
      "loss": 0.0619,
      "mae_dtheta": 0.007557443808764219,
      "mae_dx": 0.0010098445927724242,
      "mae_dy": 0.0017077194061130285,
      "pose_mae_dtheta": 0.044628579169511795,
      "pose_mae_dx": 0.014382406137883663,
      "pose_mae_dy": 0.02067972905933857,
      "pose_rmse_dtheta": 0.10473059117794037,
      "pose_rmse_dx": 0.04130447283387184,
      "pose_rmse_dy": 0.04483611881732941,
      "pose_rmse_mean": 0.06362372636795044,
      "rmse_dtheta": 0.016640208661556244,
      "rmse_dx": 0.0034021446481347084,
      "rmse_dy": 0.004087038803845644,
      "rmse_mean": 0.008043130859732628,
      "rotation_flip": 0.0008492568740621209,
      "sparse_tokens": 32041.0,
      "step": 11372,
      "turn_loss": 0.057258240878582,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.5283869169299387,
      "grad_norm": 0.8415827751159668,
      "learning_rate": 6.879039384188213e-08,
      "loss": 0.1532,
      "mae_dtheta": 0.031473442912101746,
      "mae_dx": 0.009542115032672882,
      "mae_dy": 0.003917955793440342,
      "pose_mae_dtheta": 0.2241404801607132,
      "pose_mae_dx": 0.07581789046525955,
      "pose_mae_dy": 0.046255841851234436,
      "pose_rmse_dtheta": 0.4258020222187042,
      "pose_rmse_dx": 0.17084282636642456,
      "pose_rmse_dy": 0.1066630631685257,
      "pose_rmse_mean": 0.23443597555160522,
      "rmse_dtheta": 0.049207109957933426,
      "rmse_dx": 0.02099485695362091,
      "rmse_dy": 0.007290251087397337,
      "rmse_mean": 0.025830738246440887,
      "rotation_flip": 0.01508120633661747,
      "sparse_tokens": 13425.0,
      "step": 11373,
      "turn_loss": 0.23227491974830627,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.5284333766957815,
      "grad_norm": 0.4377972185611725,
      "learning_rate": 6.857199231384282e-08,
      "loss": 0.1184,
      "mae_dtheta": 0.03731729835271835,
      "mae_dx": 0.010868941433727741,
      "mae_dy": 0.0047620972618460655,
      "pose_mae_dtheta": 0.2913818955421448,
      "pose_mae_dx": 0.06998872756958008,
      "pose_mae_dy": 0.05104100704193115,
      "pose_rmse_dtheta": 0.5021456480026245,
      "pose_rmse_dx": 0.1515481024980545,
      "pose_rmse_dy": 0.13684161007404327,
      "pose_rmse_mean": 0.2635117769241333,
      "rmse_dtheta": 0.0575631782412529,
      "rmse_dx": 0.021859783679246902,
      "rmse_dy": 0.010486094281077385,
      "rmse_mean": 0.02996968850493431,
      "rotation_flip": 0.01371428556740284,
      "sparse_tokens": 14254.0,
      "step": 11374,
      "turn_loss": 0.3016633689403534,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.5284798364616242,
      "grad_norm": 1.2610846757888794,
      "learning_rate": 6.835393564321114e-08,
      "loss": 0.2597,
      "mae_dtheta": 0.0215758066624403,
      "mae_dx": 0.007853681221604347,
      "mae_dy": 0.0020780256018042564,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.9999994039535522,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 140.42047119140625,
      "model/head/act_norm_mean": 111.71229137073864,
      "model/head/act_norm_min": 67.76319885253906,
      "model/head/act_over_embed": 76.7697324969213,
      "model/head/grad_frac": 0.11102449893951416,
      "model/head/grad_norm": 0.11102443188428879,
      "model/head/grad_zero_frac": 8.820155198918656e-05,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7037020596590909,
      "model/head/update_ratio": 0.001889944076538086,
      "model/head/weight_delta": 9.985048294067383,
      "model/head/weight_delta_rel": 0.17516732215881348,
      "model/head/weight_norm": 58.74482345581055,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228690266609192,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228690266609192,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228690266609192,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059955408358573,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09952260553836823,
      "model/modality_embedder.encoders.pose/grad_norm": 0.09952254593372345,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0032135294750332832,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1565158367156982,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313320904970169,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96985626220703,
      "model/modality_embedder/grad_frac": 0.09952260553836823,
      "model/modality_embedder/grad_norm": 0.09952254593372345,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0032135294750332832,
      "model/modality_embedder/weight_delta": 3.1565158367156982,
      "model/modality_embedder/weight_delta_rel": 0.10313320904970169,
      "model/modality_embedder/weight_norm": 30.96985626220703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 77.6399154663086,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.763401312229437,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.34472942352295,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.330431858232327,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.08082146942615509,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.08082142472267151,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015635087038390338,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0028904895298182964,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7423012256622314,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09993111342191696,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96115493774414,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.87317657470703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.55829218524531,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.826696395874023,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.876688308054437,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07902280986309052,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.07902276515960693,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0026543743442744017,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.476874828338623,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12044166028499603,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770769119262695,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.46876525878906,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.237410376082252,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.59519100189209,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.030594048949762,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0803365483880043,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.08033650368452072,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0026132189668715,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.766810894012451,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12648245692253113,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742355346679688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.26276397705078,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.030491860569985,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.770752906799316,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.262816432183076,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08318451046943665,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.08318445831537247,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00014626371557824314,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002776923356577754,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.23793625831604,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11065729707479477,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955617904663086,
      "model/normalizer/grad_frac": 0.32627367973327637,
      "model/normalizer/grad_norm": 0.32627347111701965,
      "model/normalizer/grad_zero_frac": 0.00015126251673791558,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.00414800550788641,
      "model/normalizer/weight_delta": 6.809295654296875,
      "model/normalizer/weight_delta_rel": 0.0876997858285904,
      "model/normalizer/weight_norm": 78.65792083740234,
      "pose_mae_dtheta": 0.17477548122406006,
      "pose_mae_dx": 0.06841601431369781,
      "pose_mae_dy": 0.030041655525565147,
      "pose_rmse_dtheta": 0.3386780023574829,
      "pose_rmse_dx": 0.21434330940246582,
      "pose_rmse_dy": 0.06921684741973877,
      "pose_rmse_mean": 0.2074127197265625,
      "rmse_dtheta": 0.03812593221664429,
      "rmse_dx": 0.0207636971026659,
      "rmse_dy": 0.004129166714847088,
      "rmse_mean": 0.0210062637925148,
      "rotation_flip": 0.0034246575087308884,
      "sparse_tokens": 6085.0,
      "step": 11375,
      "turn_loss": 0.11558376997709274,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.528526296227467,
      "grad_norm": 0.5958945751190186,
      "learning_rate": 6.813622384523543e-08,
      "loss": 0.1641,
      "mae_dtheta": 0.009777679108083248,
      "mae_dx": 0.002560930559411645,
      "mae_dy": 0.001998546766117215,
      "pose_mae_dtheta": 0.0634559690952301,
      "pose_mae_dx": 0.024864213541150093,
      "pose_mae_dy": 0.021186567842960358,
      "pose_rmse_dtheta": 0.19103498756885529,
      "pose_rmse_dx": 0.06054059788584709,
      "pose_rmse_dy": 0.053067002445459366,
      "pose_rmse_mean": 0.10154753178358078,
      "rmse_dtheta": 0.02648421749472618,
      "rmse_dx": 0.008564986288547516,
      "rmse_dy": 0.005204458720982075,
      "rmse_mean": 0.01341788750141859,
      "rotation_flip": 0.004142011981457472,
      "sparse_tokens": 32041.0,
      "step": 11376,
      "turn_loss": 0.12323977798223495,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5285727559933098,
      "grad_norm": 0.9768248200416565,
      "learning_rate": 6.791885693514134e-08,
      "loss": 0.2009,
      "mae_dtheta": 0.009572691284120083,
      "mae_dx": 0.002257946180179715,
      "mae_dy": 0.003654970321804285,
      "pose_mae_dtheta": 0.0651206448674202,
      "pose_mae_dx": 0.02369236759841442,
      "pose_mae_dy": 0.031863097101449966,
      "pose_rmse_dtheta": 0.17160086333751678,
      "pose_rmse_dx": 0.058144718408584595,
      "pose_rmse_dy": 0.08511919528245926,
      "pose_rmse_mean": 0.10495492815971375,
      "rmse_dtheta": 0.021561244502663612,
      "rmse_dx": 0.005585337523370981,
      "rmse_dy": 0.008996198885142803,
      "rmse_mean": 0.012047594413161278,
      "rotation_flip": 0.0035321821924299,
      "sparse_tokens": 32105.0,
      "step": 11377,
      "turn_loss": 0.10552146285772324,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5286192157591526,
      "grad_norm": 0.34424442052841187,
      "learning_rate": 6.770183492812832e-08,
      "loss": 0.0787,
      "mae_dtheta": 0.006688418798148632,
      "mae_dx": 0.0008152134832926095,
      "mae_dy": 0.00141384347807616,
      "pose_mae_dtheta": 0.04288826510310173,
      "pose_mae_dx": 0.011570625938475132,
      "pose_mae_dy": 0.02113652229309082,
      "pose_rmse_dtheta": 0.08291961252689362,
      "pose_rmse_dx": 0.029996400699019432,
      "pose_rmse_dy": 0.04667672514915466,
      "pose_rmse_mean": 0.05319758504629135,
      "rmse_dtheta": 0.0140869515016675,
      "rmse_dx": 0.0024202722124755383,
      "rmse_dy": 0.0028750388883054256,
      "rmse_mean": 0.0064607542008161545,
      "rotation_flip": 0.005321326199918985,
      "sparse_tokens": 32089.0,
      "step": 11378,
      "turn_loss": 0.054101210087537766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5286656755249953,
      "grad_norm": 0.379361629486084,
      "learning_rate": 6.748515783937315e-08,
      "loss": 0.0941,
      "mae_dtheta": 0.013354276306927204,
      "mae_dx": 0.002691281493753195,
      "mae_dy": 0.0025435187853872776,
      "pose_mae_dtheta": 0.09607554972171783,
      "pose_mae_dx": 0.025157663971185684,
      "pose_mae_dy": 0.021561596542596817,
      "pose_rmse_dtheta": 0.26921284198760986,
      "pose_rmse_dx": 0.058673642575740814,
      "pose_rmse_dy": 0.046179771423339844,
      "pose_rmse_mean": 0.1246887594461441,
      "rmse_dtheta": 0.03064456582069397,
      "rmse_dx": 0.008307193405926228,
      "rmse_dy": 0.006325220223516226,
      "rmse_mean": 0.015092326328158379,
      "rotation_flip": 0.004807692486792803,
      "sparse_tokens": 32169.0,
      "step": 11379,
      "turn_loss": 0.11593907326459885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15914.0,
      "epoch": 0.5287121352908382,
      "grad_norm": 0.4600355625152588,
      "learning_rate": 6.72688256840287e-08,
      "loss": 0.1071,
      "mae_dtheta": 0.0206824392080307,
      "mae_dx": 0.007738368585705757,
      "mae_dy": 0.003681531408801675,
      "pose_mae_dtheta": 0.15006321668624878,
      "pose_mae_dx": 0.05757264792919159,
      "pose_mae_dy": 0.029834697023034096,
      "pose_rmse_dtheta": 0.30832016468048096,
      "pose_rmse_dx": 0.14076772332191467,
      "pose_rmse_dy": 0.08085086196660995,
      "pose_rmse_mean": 0.17664626240730286,
      "rmse_dtheta": 0.037170328199863434,
      "rmse_dx": 0.017799071967601776,
      "rmse_dy": 0.007808518595993519,
      "rmse_mean": 0.0209259744733572,
      "rotation_flip": 0.011006289161741734,
      "sparse_tokens": 12589.0,
      "step": 11380,
      "turn_loss": 0.1633015125989914,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.5287585950566809,
      "grad_norm": 0.6361834406852722,
      "learning_rate": 6.705283847722288e-08,
      "loss": 0.1564,
      "mae_dtheta": 0.04254622012376785,
      "mae_dx": 0.013006223365664482,
      "mae_dy": 0.007092977873980999,
      "pose_mae_dtheta": 0.29724761843681335,
      "pose_mae_dx": 0.10337576270103455,
      "pose_mae_dy": 0.07364276796579361,
      "pose_rmse_dtheta": 0.47093263268470764,
      "pose_rmse_dx": 0.22402457892894745,
      "pose_rmse_dy": 0.1716269999742508,
      "pose_rmse_mean": 0.28886139392852783,
      "rmse_dtheta": 0.06040512025356293,
      "rmse_dx": 0.026041125878691673,
      "rmse_dy": 0.015545298345386982,
      "rmse_mean": 0.03399718552827835,
      "rotation_flip": 0.013657055795192719,
      "sparse_tokens": 22172.0,
      "step": 11381,
      "turn_loss": 0.398613303899765,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5288050548225237,
      "grad_norm": 0.42540299892425537,
      "learning_rate": 6.683719623405916e-08,
      "loss": 0.0905,
      "mae_dtheta": 0.006226537749171257,
      "mae_dx": 0.0009725125273689628,
      "mae_dy": 0.0009252289310097694,
      "pose_mae_dtheta": 0.037781972438097,
      "pose_mae_dx": 0.011075793765485287,
      "pose_mae_dy": 0.01196192391216755,
      "pose_rmse_dtheta": 0.1344030499458313,
      "pose_rmse_dx": 0.027002329006791115,
      "pose_rmse_dy": 0.03460477292537689,
      "pose_rmse_mean": 0.06533671915531158,
      "rmse_dtheta": 0.019729677587747574,
      "rmse_dx": 0.0031791033688932657,
      "rmse_dy": 0.002263820730149746,
      "rmse_mean": 0.008390868082642555,
      "rotation_flip": 0.005213269963860512,
      "sparse_tokens": 32137.0,
      "step": 11382,
      "turn_loss": 0.04299750551581383,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12674.0,
      "epoch": 0.5288515145883664,
      "grad_norm": 0.5905065536499023,
      "learning_rate": 6.662189896961824e-08,
      "loss": 0.1592,
      "mae_dtheta": 0.025163743644952774,
      "mae_dx": 0.008145267143845558,
      "mae_dy": 0.003837903728708625,
      "pose_mae_dtheta": 0.19558317959308624,
      "pose_mae_dx": 0.06661538779735565,
      "pose_mae_dy": 0.034946881234645844,
      "pose_rmse_dtheta": 0.41298073530197144,
      "pose_rmse_dx": 0.19742274284362793,
      "pose_rmse_dy": 0.06551572680473328,
      "pose_rmse_mean": 0.22530639171600342,
      "rmse_dtheta": 0.04295932874083519,
      "rmse_dx": 0.02071167528629303,
      "rmse_dy": 0.008319309912621975,
      "rmse_mean": 0.02399677410721779,
      "rotation_flip": 0.00834724586457014,
      "sparse_tokens": 10428.0,
      "step": 11383,
      "turn_loss": 0.25752919912338257,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5288979743542093,
      "grad_norm": 0.4696927070617676,
      "learning_rate": 6.640694669895642e-08,
      "loss": 0.0923,
      "mae_dtheta": 0.0074861785396933556,
      "mae_dx": 0.0012499027652665973,
      "mae_dy": 0.0014051009202376008,
      "pose_mae_dtheta": 0.05012839287519455,
      "pose_mae_dx": 0.014013763517141342,
      "pose_mae_dy": 0.016729699447751045,
      "pose_rmse_dtheta": 0.1619115173816681,
      "pose_rmse_dx": 0.04138404130935669,
      "pose_rmse_dy": 0.056684814393520355,
      "pose_rmse_mean": 0.08666013181209564,
      "rmse_dtheta": 0.021639851853251457,
      "rmse_dx": 0.0034729945473372936,
      "rmse_dy": 0.0041007413528859615,
      "rmse_mean": 0.009737863205373287,
      "rotation_flip": 0.005799903534352779,
      "sparse_tokens": 32153.0,
      "step": 11384,
      "turn_loss": 0.05200889706611633,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.528944434120052,
      "grad_norm": 0.41723546385765076,
      "learning_rate": 6.61923394371039e-08,
      "loss": 0.1009,
      "mae_dtheta": 0.01083909161388874,
      "mae_dx": 0.0017663483740761876,
      "mae_dy": 0.0025933522265404463,
      "pose_mae_dtheta": 0.06790070235729218,
      "pose_mae_dx": 0.021750031039118767,
      "pose_mae_dy": 0.026356913149356842,
      "pose_rmse_dtheta": 0.1779787689447403,
      "pose_rmse_dx": 0.07221129536628723,
      "pose_rmse_dy": 0.05513735115528107,
      "pose_rmse_mean": 0.10177581012248993,
      "rmse_dtheta": 0.02181294932961464,
      "rmse_dx": 0.006341429427266121,
      "rmse_dy": 0.006656398065388203,
      "rmse_mean": 0.01160359289497137,
      "rotation_flip": 0.005681818351149559,
      "sparse_tokens": 32105.0,
      "step": 11385,
      "turn_loss": 0.0777159184217453,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5289908938858948,
      "grad_norm": 0.41101059317588806,
      "learning_rate": 6.597807719907034e-08,
      "loss": 0.0818,
      "mae_dtheta": 0.006358712445944548,
      "mae_dx": 0.0018834850052371621,
      "mae_dy": 0.0028401887975633144,
      "pose_mae_dtheta": 0.04043033346533775,
      "pose_mae_dx": 0.026494110003113747,
      "pose_mae_dy": 0.021308589726686478,
      "pose_rmse_dtheta": 0.08233334124088287,
      "pose_rmse_dx": 0.06998281180858612,
      "pose_rmse_dy": 0.043373577296733856,
      "pose_rmse_mean": 0.06522991508245468,
      "rmse_dtheta": 0.013081390410661697,
      "rmse_dx": 0.0048039499670267105,
      "rmse_dy": 0.0059934803284704685,
      "rmse_mean": 0.007959607057273388,
      "rotation_flip": 0.0026840490754693747,
      "sparse_tokens": 32057.0,
      "step": 11386,
      "turn_loss": 0.06594973057508469,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.5290373536517375,
      "grad_norm": 0.47086992859840393,
      "learning_rate": 6.57641599998371e-08,
      "loss": 0.1075,
      "mae_dtheta": 0.0337531641125679,
      "mae_dx": 0.005616049747914076,
      "mae_dy": 0.005566202569752932,
      "pose_mae_dtheta": 0.2679624557495117,
      "pose_mae_dx": 0.0645960345864296,
      "pose_mae_dy": 0.06783974170684814,
      "pose_rmse_dtheta": 0.5401239991188049,
      "pose_rmse_dx": 0.15837496519088745,
      "pose_rmse_dy": 0.217825785279274,
      "pose_rmse_mean": 0.30544158816337585,
      "rmse_dtheta": 0.05643410608172417,
      "rmse_dx": 0.013004234991967678,
      "rmse_dy": 0.013989748433232307,
      "rmse_mean": 0.02780936285853386,
      "rotation_flip": 0.006185567006468773,
      "sparse_tokens": 7846.0,
      "step": 11387,
      "turn_loss": 0.20450712740421295,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5290838134175804,
      "grad_norm": 0.4550938010215759,
      "learning_rate": 6.555058785436553e-08,
      "loss": 0.1178,
      "mae_dtheta": 0.010484459809958935,
      "mae_dx": 0.001653285464271903,
      "mae_dy": 0.0027851799968630075,
      "pose_mae_dtheta": 0.06478801369667053,
      "pose_mae_dx": 0.021730130538344383,
      "pose_mae_dy": 0.030154502019286156,
      "pose_rmse_dtheta": 0.1276635378599167,
      "pose_rmse_dx": 0.05146455764770508,
      "pose_rmse_dy": 0.07223938405513763,
      "pose_rmse_mean": 0.08378916233778,
      "rmse_dtheta": 0.020358456298708916,
      "rmse_dx": 0.004324313718825579,
      "rmse_dy": 0.0058668917044997215,
      "rmse_mean": 0.010183220729231834,
      "rotation_flip": 0.012585400603711605,
      "sparse_tokens": 32121.0,
      "step": 11388,
      "turn_loss": 0.0990954339504242,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.5291302731834232,
      "grad_norm": 0.6448641419410706,
      "learning_rate": 6.533736077758868e-08,
      "loss": 0.1354,
      "mae_dtheta": 0.03155771642923355,
      "mae_dx": 0.01317685842514038,
      "mae_dy": 0.005322312004864216,
      "pose_mae_dtheta": 0.23855723440647125,
      "pose_mae_dx": 0.09590590745210648,
      "pose_mae_dy": 0.08309914916753769,
      "pose_rmse_dtheta": 0.47368890047073364,
      "pose_rmse_dx": 0.21402640640735626,
      "pose_rmse_dy": 0.16691061854362488,
      "pose_rmse_mean": 0.2848753333091736,
      "rmse_dtheta": 0.04966454580426216,
      "rmse_dx": 0.026823384687304497,
      "rmse_dy": 0.009174005128443241,
      "rmse_mean": 0.028553977608680725,
      "rotation_flip": 0.013953488320112228,
      "sparse_tokens": 9985.0,
      "step": 11389,
      "turn_loss": 0.20431050658226013,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5291767329492659,
      "grad_norm": 0.270376980304718,
      "learning_rate": 6.512447878441963e-08,
      "loss": 0.0662,
      "mae_dtheta": 0.009598266333341599,
      "mae_dx": 0.0019293739460408688,
      "mae_dy": 0.0017737372545525432,
      "pose_mae_dtheta": 0.06415680795907974,
      "pose_mae_dx": 0.018623942509293556,
      "pose_mae_dy": 0.01774444431066513,
      "pose_rmse_dtheta": 0.19006703794002533,
      "pose_rmse_dx": 0.061512332409620285,
      "pose_rmse_dy": 0.04714803770184517,
      "pose_rmse_mean": 0.09957581013441086,
      "rmse_dtheta": 0.023352565243840218,
      "rmse_dx": 0.006840905640274286,
      "rmse_dy": 0.00444193696603179,
      "rmse_mean": 0.011545135639607906,
      "rotation_flip": 0.004191407468169928,
      "sparse_tokens": 32169.0,
      "step": 11390,
      "turn_loss": 0.06863294541835785,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5292231927151088,
      "grad_norm": 0.434461385011673,
      "learning_rate": 6.491194188974426e-08,
      "loss": 0.0988,
      "mae_dtheta": 0.007712641730904579,
      "mae_dx": 0.001078039058484137,
      "mae_dy": 0.0015844935551285744,
      "pose_mae_dtheta": 0.05353013426065445,
      "pose_mae_dx": 0.017075084149837494,
      "pose_mae_dy": 0.01961267739534378,
      "pose_rmse_dtheta": 0.18793563544750214,
      "pose_rmse_dx": 0.06022777408361435,
      "pose_rmse_dy": 0.056574877351522446,
      "pose_rmse_mean": 0.10157942771911621,
      "rmse_dtheta": 0.021487530320882797,
      "rmse_dx": 0.0038119826931506395,
      "rmse_dy": 0.004397098440676928,
      "rmse_mean": 0.009898871183395386,
      "rotation_flip": 0.003638017224147916,
      "sparse_tokens": 32089.0,
      "step": 11391,
      "turn_loss": 0.05411320552229881,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24987.0,
      "epoch": 0.5292696524809515,
      "grad_norm": 0.4448731243610382,
      "learning_rate": 6.469975010842511e-08,
      "loss": 0.1315,
      "mae_dtheta": 0.029614295810461044,
      "mae_dx": 0.01062443945556879,
      "mae_dy": 0.005405615083873272,
      "pose_mae_dtheta": 0.22277197241783142,
      "pose_mae_dx": 0.08122167736291885,
      "pose_mae_dy": 0.06434362381696701,
      "pose_rmse_dtheta": 0.4247555732727051,
      "pose_rmse_dx": 0.20306827127933502,
      "pose_rmse_dy": 0.18668237328529358,
      "pose_rmse_mean": 0.2715020775794983,
      "rmse_dtheta": 0.048367150127887726,
      "rmse_dx": 0.02383541874587536,
      "rmse_dy": 0.013711126521229744,
      "rmse_mean": 0.028637899085879326,
      "rotation_flip": 0.016172505915164948,
      "sparse_tokens": 19555.0,
      "step": 11392,
      "turn_loss": 0.3182811439037323,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.5293161122467943,
      "grad_norm": 0.5564897060394287,
      "learning_rate": 6.448790345530253e-08,
      "loss": 0.0834,
      "mae_dtheta": 0.05775896832346916,
      "mae_dx": 0.013333539478480816,
      "mae_dy": 0.0037001471500843763,
      "pose_mae_dtheta": 0.5296480655670166,
      "pose_mae_dx": 0.11560780555009842,
      "pose_mae_dy": 0.03307008370757103,
      "pose_rmse_dtheta": 0.815355658531189,
      "pose_rmse_dx": 0.23959775269031525,
      "pose_rmse_dy": 0.08398449420928955,
      "pose_rmse_mean": 0.3796460032463074,
      "rmse_dtheta": 0.07677528262138367,
      "rmse_dx": 0.025846296921372414,
      "rmse_dy": 0.006910349708050489,
      "rmse_mean": 0.0365106426179409,
      "rotation_flip": 0.011173184029757977,
      "sparse_tokens": 5479.0,
      "step": 11393,
      "turn_loss": 0.3253227770328522,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 24986.0,
      "epoch": 0.529362572012637,
      "grad_norm": 0.40150371193885803,
      "learning_rate": 6.427640194518858e-08,
      "loss": 0.1081,
      "mae_dtheta": 0.026695141568779945,
      "mae_dx": 0.00917627103626728,
      "mae_dy": 0.005419928580522537,
      "pose_mae_dtheta": 0.19406813383102417,
      "pose_mae_dx": 0.07550127059221268,
      "pose_mae_dy": 0.05613788589835167,
      "pose_rmse_dtheta": 0.38090017437934875,
      "pose_rmse_dx": 0.19730663299560547,
      "pose_rmse_dy": 0.14168681204319,
      "pose_rmse_mean": 0.2399645298719406,
      "rmse_dtheta": 0.044729895889759064,
      "rmse_dx": 0.020523495972156525,
      "rmse_dy": 0.013277758844196796,
      "rmse_mean": 0.026177052408456802,
      "rotation_flip": 0.008458646945655346,
      "sparse_tokens": 20594.0,
      "step": 11394,
      "turn_loss": 0.2173611968755722,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5294090317784799,
      "grad_norm": 0.3197108507156372,
      "learning_rate": 6.406524559287641e-08,
      "loss": 0.0755,
      "mae_dtheta": 0.007802386302500963,
      "mae_dx": 0.0010027885437011719,
      "mae_dy": 0.0013013732386752963,
      "pose_mae_dtheta": 0.05371228605508804,
      "pose_mae_dx": 0.011699688620865345,
      "pose_mae_dy": 0.01804015040397644,
      "pose_rmse_dtheta": 0.18220967054367065,
      "pose_rmse_dx": 0.0309341698884964,
      "pose_rmse_dy": 0.04709107056260109,
      "pose_rmse_mean": 0.08674497902393341,
      "rmse_dtheta": 0.021885523572564125,
      "rmse_dx": 0.0037080824840813875,
      "rmse_dy": 0.003194397548213601,
      "rmse_mean": 0.009596001356840134,
      "rotation_flip": 0.0036613272968679667,
      "sparse_tokens": 32105.0,
      "step": 11395,
      "turn_loss": 0.06338605284690857,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 31144.0,
      "epoch": 0.5294554915443226,
      "grad_norm": 0.9468613266944885,
      "learning_rate": 6.385443441312977e-08,
      "loss": 0.3018,
      "mae_dtheta": 0.029026148840785027,
      "mae_dx": 0.011074481531977654,
      "mae_dy": 0.00633636862039566,
      "pose_mae_dtheta": 0.210508793592453,
      "pose_mae_dx": 0.08721119910478592,
      "pose_mae_dy": 0.057020943611860275,
      "pose_rmse_dtheta": 0.3970731794834137,
      "pose_rmse_dx": 0.19181585311889648,
      "pose_rmse_dy": 0.14665977656841278,
      "pose_rmse_mean": 0.24518293142318726,
      "rmse_dtheta": 0.04724021628499031,
      "rmse_dx": 0.021867431700229645,
      "rmse_dy": 0.014655566774308681,
      "rmse_mean": 0.027921073138713837,
      "rotation_flip": 0.010891763493418694,
      "sparse_tokens": 25302.0,
      "step": 11396,
      "turn_loss": 0.31223264336586,
      "turns": 96.0,
      "turns_per_sample": 96.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.5295019513101654,
      "grad_norm": 0.6407864093780518,
      "learning_rate": 6.364396842069243e-08,
      "loss": 0.1135,
      "mae_dtheta": 0.031912561506032944,
      "mae_dx": 0.005522634368389845,
      "mae_dy": 0.0008405015687458217,
      "pose_mae_dtheta": 0.25617536902427673,
      "pose_mae_dx": 0.04893951863050461,
      "pose_mae_dy": 0.010084351524710655,
      "pose_rmse_dtheta": 0.45088526606559753,
      "pose_rmse_dx": 0.1012214869260788,
      "pose_rmse_dy": 0.02754781022667885,
      "pose_rmse_mean": 0.1932182013988495,
      "rmse_dtheta": 0.054031774401664734,
      "rmse_dx": 0.012150583788752556,
      "rmse_dy": 0.0020793282892555,
      "rmse_mean": 0.022753898054361343,
      "rotation_flip": 0.009302325546741486,
      "sparse_tokens": 3668.0,
      "step": 11397,
      "turn_loss": 0.2039344161748886,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 32015.0,
      "epoch": 0.5295484110760081,
      "grad_norm": 0.5235651731491089,
      "learning_rate": 6.343384763028149e-08,
      "loss": 0.1454,
      "mae_dtheta": 0.039047762751579285,
      "mae_dx": 0.01223547849804163,
      "mae_dy": 0.0042046126909554005,
      "pose_mae_dtheta": 0.3484843671321869,
      "pose_mae_dx": 0.09204290807247162,
      "pose_mae_dy": 0.05306335166096687,
      "pose_rmse_dtheta": 0.6251890063285828,
      "pose_rmse_dx": 0.20063325762748718,
      "pose_rmse_dy": 0.14708949625492096,
      "pose_rmse_mean": 0.32430392503738403,
      "rmse_dtheta": 0.0597706064581871,
      "rmse_dx": 0.024414943531155586,
      "rmse_dy": 0.008874775841832161,
      "rmse_mean": 0.031020108610391617,
      "rotation_flip": 0.010107817128300667,
      "sparse_tokens": 24023.0,
      "step": 11398,
      "turn_loss": 0.2682792544364929,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.529594870841851,
      "grad_norm": 0.40884432196617126,
      "learning_rate": 6.322407205659131e-08,
      "loss": 0.1116,
      "mae_dtheta": 0.026981892064213753,
      "mae_dx": 0.006288860458880663,
      "mae_dy": 0.005046817474067211,
      "pose_mae_dtheta": 0.20455990731716156,
      "pose_mae_dx": 0.04679622873663902,
      "pose_mae_dy": 0.05406960844993591,
      "pose_rmse_dtheta": 0.4228333830833435,
      "pose_rmse_dx": 0.1098613515496254,
      "pose_rmse_dy": 0.11696793138980865,
      "pose_rmse_mean": 0.21655422449111938,
      "rmse_dtheta": 0.04438761621713638,
      "rmse_dx": 0.015147757716476917,
      "rmse_dy": 0.008977638557553291,
      "rmse_mean": 0.022837672382593155,
      "rotation_flip": 0.005571030545979738,
      "sparse_tokens": 6231.0,
      "step": 11399,
      "turn_loss": 0.21446503698825836,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5296413306076937,
      "grad_norm": 0.4555244445800781,
      "learning_rate": 6.30146417142924e-08,
      "loss": 0.0998,
      "mae_dtheta": 0.007702426519244909,
      "mae_dx": 0.0011926381848752499,
      "mae_dy": 0.001577211543917656,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4555244445800781,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 162.4459228515625,
      "model/head/act_norm_mean": 121.30111663510101,
      "model/head/act_norm_min": 58.11898422241211,
      "model/head/act_over_embed": 83.35926299058764,
      "model/head/grad_frac": 0.10231935232877731,
      "model/head/grad_norm": 0.04660896584391594,
      "model/head/grad_zero_frac": 0.00018084491603076458,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7032630997474747,
      "model/head/update_ratio": 0.0007934137247502804,
      "model/head/weight_delta": 9.985198020935059,
      "model/head/weight_delta_rel": 0.1751699447631836,
      "model/head/weight_norm": 58.74484634399414,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.422931969165802,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228676081772877,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228091835975647,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059857928835414,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11867155879735947,
      "model/modality_embedder.encoders.pose/grad_norm": 0.05405779555439949,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5443350616591929,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017454968765377998,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1566243171691895,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313675552606583,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969860076904297,
      "model/modality_embedder/grad_frac": 0.11867155879735947,
      "model/modality_embedder/grad_norm": 0.05405779555439949,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5443350616591929,
      "model/modality_embedder/update_ratio": 0.0017454968765377998,
      "model/modality_embedder/weight_delta": 3.1566243171691895,
      "model/modality_embedder/weight_delta_rel": 0.10313675552606583,
      "model/modality_embedder/weight_norm": 30.969860076904297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 91.93240356445312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.72904140612474,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.994366645812988,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.994028771222172,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0543222539126873,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.024745114147663116,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008849815931171179,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7423713207244873,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0999336689710617,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961162567138672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.03241729736328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.742020903479236,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.077449798583984,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.690157765467657,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05826030671596527,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.026538994163274765,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008914441568776965,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.476977586746216,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12044522166252136,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77078628540039,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 94.51128387451172,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.577821869488535,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.011322021484375,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.951737376348675,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05456070229411125,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02485373429954052,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0003026145859621465,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000808452139608562,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.766918182373047,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12648606300354004,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742368698120117,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 95.08670806884766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.243273508898508,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.918699264526367,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.096251335155117,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0536346398293972,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02443188987672329,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008156020776368678,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.238037586212158,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11066076159477234,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955650329589844,
      "model/normalizer/grad_frac": 0.1732998937368393,
      "model/normalizer/grad_norm": 0.07894233614206314,
      "model/normalizer/grad_zero_frac": 0.00023516594956163317,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010036155581474304,
      "model/normalizer/weight_delta": 6.809491157531738,
      "model/normalizer/weight_delta_rel": 0.08770230412483215,
      "model/normalizer/weight_norm": 78.65794372558594,
      "pose_mae_dtheta": 0.05395106226205826,
      "pose_mae_dx": 0.01328042708337307,
      "pose_mae_dy": 0.019314700737595558,
      "pose_rmse_dtheta": 0.17375414073467255,
      "pose_rmse_dx": 0.03488902002573013,
      "pose_rmse_dy": 0.061069928109645844,
      "pose_rmse_mean": 0.08990436792373657,
      "rmse_dtheta": 0.021227359771728516,
      "rmse_dx": 0.0035571486223489046,
      "rmse_dy": 0.0038820200134068727,
      "rmse_mean": 0.009555510245263577,
      "rotation_flip": 0.004892367869615555,
      "sparse_tokens": 32105.0,
      "step": 11400,
      "turn_loss": 0.06030667945742607,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.5296413306076937,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30154749751091003,
      "eval_objectnav_nopose_mae_dtheta": 0.038979385048151016,
      "eval_objectnav_nopose_mae_dx": 0.012905017472803593,
      "eval_objectnav_nopose_mae_dy": 0.004844199400395155,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31324493885040283,
      "eval_objectnav_nopose_pose_mae_dx": 0.10315747559070587,
      "eval_objectnav_nopose_pose_mae_dy": 0.0534432977437973,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5324100852012634,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2285587042570114,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1264135241508484,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29579412937164307,
      "eval_objectnav_nopose_rmse_dtheta": 0.0568225271999836,
      "eval_objectnav_nopose_rmse_dx": 0.02548031508922577,
      "eval_objectnav_nopose_rmse_dy": 0.009858622215688229,
      "eval_objectnav_nopose_rmse_mean": 0.030720487236976624,
      "eval_objectnav_nopose_rotation_flip": 0.01488848589360714,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30154749751091003,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 11400
    },
    {
      "epoch": 0.5296413306076937,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27004474401474,
      "eval_objectnav_pose_mae_dtheta": 0.03459136560559273,
      "eval_objectnav_pose_mae_dx": 0.01074013952165842,
      "eval_objectnav_pose_mae_dy": 0.004562567453831434,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2573812007904053,
      "eval_objectnav_pose_pose_mae_dx": 0.08421008288860321,
      "eval_objectnav_pose_pose_mae_dy": 0.04689044505357742,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45460981130599976,
      "eval_objectnav_pose_pose_rmse_dx": 0.19791534543037415,
      "eval_objectnav_pose_pose_rmse_dy": 0.11283863335847855,
      "eval_objectnav_pose_pose_rmse_mean": 0.25512129068374634,
      "eval_objectnav_pose_rmse_dtheta": 0.05231638625264168,
      "eval_objectnav_pose_rmse_dx": 0.02280058152973652,
      "eval_objectnav_pose_rmse_dy": 0.00954057089984417,
      "eval_objectnav_pose_rmse_mean": 0.028219182044267654,
      "eval_objectnav_pose_rotation_flip": 0.01566569320857525,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27004474401474,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 11400
    },
    {
      "epoch": 0.5296413306076937,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08775898814201355,
      "eval_pointnav_mae_dtheta": 0.009930489584803581,
      "eval_pointnav_mae_dx": 0.0022426138166338205,
      "eval_pointnav_mae_dy": 0.0022997185587882996,
      "eval_pointnav_pose_mae_dtheta": 0.06815540790557861,
      "eval_pointnav_pose_mae_dx": 0.02485102228820324,
      "eval_pointnav_pose_mae_dy": 0.024492505937814713,
      "eval_pointnav_pose_rmse_dtheta": 0.2009887546300888,
      "eval_pointnav_pose_rmse_dx": 0.08017043024301529,
      "eval_pointnav_pose_rmse_dy": 0.07165231555700302,
      "eval_pointnav_pose_rmse_mean": 0.1176038384437561,
      "eval_pointnav_rmse_dtheta": 0.02508527599275112,
      "eval_pointnav_rmse_dx": 0.007342500612139702,
      "eval_pointnav_rmse_dy": 0.006232403218746185,
      "eval_pointnav_rmse_mean": 0.01288672722876072,
      "eval_pointnav_rotation_flip": 0.0045548235066235065,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08775898814201355,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 11400
    },
    {
      "epoch": 0.5296413306076937,
      "eval_loss": 0.21978374322255453,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.30154749751091003,
      "eval_objectnav_nopose_mae_dtheta": 0.038979385048151016,
      "eval_objectnav_nopose_mae_dx": 0.012905017472803593,
      "eval_objectnav_nopose_mae_dy": 0.004844199400395155,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.31324493885040283,
      "eval_objectnav_nopose_pose_mae_dx": 0.10315747559070587,
      "eval_objectnav_nopose_pose_mae_dy": 0.0534432977437973,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5324100852012634,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2285587042570114,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1264135241508484,
      "eval_objectnav_nopose_pose_rmse_mean": 0.29579412937164307,
      "eval_objectnav_nopose_rmse_dtheta": 0.0568225271999836,
      "eval_objectnav_nopose_rmse_dx": 0.02548031508922577,
      "eval_objectnav_nopose_rmse_dy": 0.009858622215688229,
      "eval_objectnav_nopose_rmse_mean": 0.030720487236976624,
      "eval_objectnav_nopose_rotation_flip": 0.01488848589360714,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.30154749751091003,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.27004474401474,
      "eval_objectnav_pose_mae_dtheta": 0.03459136560559273,
      "eval_objectnav_pose_mae_dx": 0.01074013952165842,
      "eval_objectnav_pose_mae_dy": 0.004562567453831434,
      "eval_objectnav_pose_pose_mae_dtheta": 0.2573812007904053,
      "eval_objectnav_pose_pose_mae_dx": 0.08421008288860321,
      "eval_objectnav_pose_pose_mae_dy": 0.04689044505357742,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.45460981130599976,
      "eval_objectnav_pose_pose_rmse_dx": 0.19791534543037415,
      "eval_objectnav_pose_pose_rmse_dy": 0.11283863335847855,
      "eval_objectnav_pose_pose_rmse_mean": 0.25512129068374634,
      "eval_objectnav_pose_rmse_dtheta": 0.05231638625264168,
      "eval_objectnav_pose_rmse_dx": 0.02280058152973652,
      "eval_objectnav_pose_rmse_dy": 0.00954057089984417,
      "eval_objectnav_pose_rmse_mean": 0.028219182044267654,
      "eval_objectnav_pose_rotation_flip": 0.01566569320857525,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.27004474401474,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08775898814201355,
      "eval_pointnav_mae_dtheta": 0.009930489584803581,
      "eval_pointnav_mae_dx": 0.0022426138166338205,
      "eval_pointnav_mae_dy": 0.0022997185587882996,
      "eval_pointnav_pose_mae_dtheta": 0.06815540790557861,
      "eval_pointnav_pose_mae_dx": 0.02485102228820324,
      "eval_pointnav_pose_mae_dy": 0.024492505937814713,
      "eval_pointnav_pose_rmse_dtheta": 0.2009887546300888,
      "eval_pointnav_pose_rmse_dx": 0.08017043024301529,
      "eval_pointnav_pose_rmse_dy": 0.07165231555700302,
      "eval_pointnav_pose_rmse_mean": 0.1176038384437561,
      "eval_pointnav_rmse_dtheta": 0.02508527599275112,
      "eval_pointnav_rmse_dx": 0.007342500612139702,
      "eval_pointnav_rmse_dy": 0.006232403218746185,
      "eval_pointnav_rmse_mean": 0.01288672722876072,
      "eval_pointnav_rotation_flip": 0.0045548235066235065,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08775898814201355,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 11400
    },
    {
      "dense_tokens": 33738.0,
      "epoch": 0.5296877903735365,
      "grad_norm": 0.6015264987945557,
      "learning_rate": 6.280555661802857e-08,
      "loss": 0.1767,
      "mae_dtheta": 0.02842659130692482,
      "mae_dx": 0.011234006844460964,
      "mae_dy": 0.0037195533514022827,
      "pose_mae_dtheta": 0.20481857657432556,
      "pose_mae_dx": 0.08992080390453339,
      "pose_mae_dy": 0.036539942026138306,
      "pose_rmse_dtheta": 0.3699539303779602,
      "pose_rmse_dx": 0.20151570439338684,
      "pose_rmse_dy": 0.08667843788862228,
      "pose_rmse_mean": 0.21938270330429077,
      "rmse_dtheta": 0.044339459389448166,
      "rmse_dx": 0.023122787475585938,
      "rmse_dy": 0.007696144748479128,
      "rmse_mean": 0.02505279891192913,
      "rotation_flip": 0.01569186896085739,
      "sparse_tokens": 26317.0,
      "step": 11401,
      "turn_loss": 0.23468557000160217,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5297342501393792,
      "grad_norm": 0.7383907437324524,
      "learning_rate": 6.259681678242202e-08,
      "loss": 0.1156,
      "mae_dtheta": 0.010661860927939415,
      "mae_dx": 0.003702374640852213,
      "mae_dy": 0.0027720921207219362,
      "pose_mae_dtheta": 0.07997579127550125,
      "pose_mae_dx": 0.036286067217588425,
      "pose_mae_dy": 0.031611669808626175,
      "pose_rmse_dtheta": 0.20181214809417725,
      "pose_rmse_dx": 0.10850626975297928,
      "pose_rmse_dy": 0.0865311399102211,
      "pose_rmse_mean": 0.13228318095207214,
      "rmse_dtheta": 0.024385279044508934,
      "rmse_dx": 0.01173770148307085,
      "rmse_dy": 0.006822013761848211,
      "rmse_mean": 0.01431499794125557,
      "rotation_flip": 0.003287671133875847,
      "sparse_tokens": 32089.0,
      "step": 11402,
      "turn_loss": 0.09932441264390945,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 42706.0,
      "epoch": 0.5297807099052221,
      "grad_norm": 0.3871302604675293,
      "learning_rate": 6.238842222207053e-08,
      "loss": 0.1296,
      "mae_dtheta": 0.037164926528930664,
      "mae_dx": 0.009495208971202374,
      "mae_dy": 0.003914387430995703,
      "pose_mae_dtheta": 0.2944391071796417,
      "pose_mae_dx": 0.07965913414955139,
      "pose_mae_dy": 0.04256686568260193,
      "pose_rmse_dtheta": 0.5214964747428894,
      "pose_rmse_dx": 0.16672305762767792,
      "pose_rmse_dy": 0.1274399310350418,
      "pose_rmse_mean": 0.2718864977359772,
      "rmse_dtheta": 0.05654958263039589,
      "rmse_dx": 0.01968953385949135,
      "rmse_dy": 0.009950063191354275,
      "rmse_mean": 0.028729727491736412,
      "rotation_flip": 0.015259410254657269,
      "sparse_tokens": 30106.0,
      "step": 11403,
      "turn_loss": 0.27869170904159546,
      "turns": 132.0,
      "turns_per_sample": 132.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5298271696710649,
      "grad_norm": 0.44062045216560364,
      "learning_rate": 6.218037295154634e-08,
      "loss": 0.0787,
      "mae_dtheta": 0.006771045736968517,
      "mae_dx": 0.0009909424697980285,
      "mae_dy": 0.0013298235135152936,
      "pose_mae_dtheta": 0.04166382923722267,
      "pose_mae_dx": 0.012280701659619808,
      "pose_mae_dy": 0.016533460468053818,
      "pose_rmse_dtheta": 0.11696352809667587,
      "pose_rmse_dx": 0.03411741182208061,
      "pose_rmse_dy": 0.04274018108844757,
      "pose_rmse_mean": 0.06460703909397125,
      "rmse_dtheta": 0.018566586077213287,
      "rmse_dx": 0.0030756548512727022,
      "rmse_dy": 0.0031802437733858824,
      "rmse_mean": 0.00827416218817234,
      "rotation_flip": 0.004904146306216717,
      "sparse_tokens": 32105.0,
      "step": 11404,
      "turn_loss": 0.05501588061451912,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.5298736294369076,
      "grad_norm": 0.42252877354621887,
      "learning_rate": 6.197266898539944e-08,
      "loss": 0.0988,
      "mae_dtheta": 0.028435129672288895,
      "mae_dx": 0.00813363865017891,
      "mae_dy": 0.004299852531403303,
      "pose_mae_dtheta": 0.21005116403102875,
      "pose_mae_dx": 0.06712855398654938,
      "pose_mae_dy": 0.04938090965151787,
      "pose_rmse_dtheta": 0.37699663639068604,
      "pose_rmse_dx": 0.18307986855506897,
      "pose_rmse_dy": 0.12041889876127243,
      "pose_rmse_mean": 0.22683179378509521,
      "rmse_dtheta": 0.04468617960810661,
      "rmse_dx": 0.01999257691204548,
      "rmse_dy": 0.008520037867128849,
      "rmse_mean": 0.02439959906041622,
      "rotation_flip": 0.01434034388512373,
      "sparse_tokens": 17721.0,
      "step": 11405,
      "turn_loss": 0.2052140086889267,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.5299200892027505,
      "grad_norm": 1.1894254684448242,
      "learning_rate": 6.176531033815436e-08,
      "loss": 0.3246,
      "mae_dtheta": 0.03930998221039772,
      "mae_dx": 0.008199498057365417,
      "mae_dy": 0.005664699245244265,
      "pose_mae_dtheta": 0.2807217836380005,
      "pose_mae_dx": 0.06981121748685837,
      "pose_mae_dy": 0.06694865971803665,
      "pose_rmse_dtheta": 0.5305777192115784,
      "pose_rmse_dx": 0.1645943522453308,
      "pose_rmse_dy": 0.18300117552280426,
      "pose_rmse_mean": 0.2927244305610657,
      "rmse_dtheta": 0.0612514391541481,
      "rmse_dx": 0.018666554242372513,
      "rmse_dy": 0.012282225303351879,
      "rmse_mean": 0.03073340654373169,
      "rotation_flip": 0.022058824077248573,
      "sparse_tokens": 7832.0,
      "step": 11406,
      "turn_loss": 0.2026159018278122,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5299665489685932,
      "grad_norm": 0.3224920332431793,
      "learning_rate": 6.15582970243117e-08,
      "loss": 0.0765,
      "mae_dtheta": 0.009134544059634209,
      "mae_dx": 0.0017744011711329222,
      "mae_dy": 0.0025419630110263824,
      "pose_mae_dtheta": 0.061028774827718735,
      "pose_mae_dx": 0.020841514691710472,
      "pose_mae_dy": 0.023624613881111145,
      "pose_rmse_dtheta": 0.15005053579807281,
      "pose_rmse_dx": 0.055339548736810684,
      "pose_rmse_dy": 0.062068454921245575,
      "pose_rmse_mean": 0.08915284276008606,
      "rmse_dtheta": 0.02038145810365677,
      "rmse_dx": 0.005289119202643633,
      "rmse_dy": 0.007344575133174658,
      "rmse_mean": 0.011005050502717495,
      "rotation_flip": 0.0073472545482218266,
      "sparse_tokens": 32121.0,
      "step": 11407,
      "turn_loss": 0.0842471644282341,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 34388.0,
      "epoch": 0.530013008734436,
      "grad_norm": 0.6333799362182617,
      "learning_rate": 6.135162905834713e-08,
      "loss": 0.1982,
      "mae_dtheta": 0.03815436363220215,
      "mae_dx": 0.014409824274480343,
      "mae_dy": 0.006678830366581678,
      "pose_mae_dtheta": 0.30244484543800354,
      "pose_mae_dx": 0.1147102490067482,
      "pose_mae_dy": 0.08066108077764511,
      "pose_rmse_dtheta": 0.5230247974395752,
      "pose_rmse_dx": 0.24742913246154785,
      "pose_rmse_dy": 0.19452066719532013,
      "pose_rmse_mean": 0.321658194065094,
      "rmse_dtheta": 0.05672331154346466,
      "rmse_dx": 0.027529072016477585,
      "rmse_dy": 0.01432887278497219,
      "rmse_mean": 0.032860420644283295,
      "rotation_flip": 0.014184396713972092,
      "sparse_tokens": 26006.0,
      "step": 11408,
      "turn_loss": 0.33883413672447205,
      "turns": 106.0,
      "turns_per_sample": 106.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5300594685002787,
      "grad_norm": 0.3851390779018402,
      "learning_rate": 6.114530645471461e-08,
      "loss": 0.1016,
      "mae_dtheta": 0.009479137137532234,
      "mae_dx": 0.0022883424535393715,
      "mae_dy": 0.002695988630875945,
      "pose_mae_dtheta": 0.06630243360996246,
      "pose_mae_dx": 0.02199416048824787,
      "pose_mae_dy": 0.023599382489919662,
      "pose_rmse_dtheta": 0.1606580764055252,
      "pose_rmse_dx": 0.06051933765411377,
      "pose_rmse_dy": 0.051420293748378754,
      "pose_rmse_mean": 0.09086590260267258,
      "rmse_dtheta": 0.019901784136891365,
      "rmse_dx": 0.0075469184666872025,
      "rmse_dy": 0.00734388642013073,
      "rmse_mean": 0.01159752905368805,
      "rotation_flip": 0.002958579920232296,
      "sparse_tokens": 32137.0,
      "step": 11409,
      "turn_loss": 0.08427329361438751,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.5301059282661216,
      "grad_norm": 0.4662507474422455,
      "learning_rate": 6.093932922784152e-08,
      "loss": 0.0789,
      "mae_dtheta": 0.02464882843196392,
      "mae_dx": 0.007151382509618998,
      "mae_dy": 0.004074458032846451,
      "pose_mae_dtheta": 0.18004299700260162,
      "pose_mae_dx": 0.06276683509349823,
      "pose_mae_dy": 0.05492305010557175,
      "pose_rmse_dtheta": 0.370377779006958,
      "pose_rmse_dx": 0.17935068905353546,
      "pose_rmse_dy": 0.13895335793495178,
      "pose_rmse_mean": 0.22956061363220215,
      "rmse_dtheta": 0.043203528970479965,
      "rmse_dx": 0.019326267763972282,
      "rmse_dy": 0.009664682671427727,
      "rmse_mean": 0.02406482771039009,
      "rotation_flip": 0.008417508564889431,
      "sparse_tokens": 12597.0,
      "step": 11410,
      "turn_loss": 0.18603678047657013,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 27171.0,
      "epoch": 0.5301523880319643,
      "grad_norm": 0.8969897627830505,
      "learning_rate": 6.073369739213241e-08,
      "loss": 0.2527,
      "mae_dtheta": 0.03476467728614807,
      "mae_dx": 0.013664801605045795,
      "mae_dy": 0.005364249460399151,
      "pose_mae_dtheta": 0.2753908336162567,
      "pose_mae_dx": 0.10846219211816788,
      "pose_mae_dy": 0.0666378065943718,
      "pose_rmse_dtheta": 0.4924297034740448,
      "pose_rmse_dx": 0.25663742423057556,
      "pose_rmse_dy": 0.15514768660068512,
      "pose_rmse_mean": 0.3014049530029297,
      "rmse_dtheta": 0.053136277943849564,
      "rmse_dx": 0.02740626037120819,
      "rmse_dy": 0.010678164660930634,
      "rmse_mean": 0.030406899750232697,
      "rotation_flip": 0.011317703872919083,
      "sparse_tokens": 22106.0,
      "step": 11411,
      "turn_loss": 0.2810872793197632,
      "turns": 84.0,
      "turns_per_sample": 84.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.5301988477978071,
      "grad_norm": 1.119062066078186,
      "learning_rate": 6.052841096196637e-08,
      "loss": 0.2525,
      "mae_dtheta": 0.04231944680213928,
      "mae_dx": 0.012867052108049393,
      "mae_dy": 0.0051528094336390495,
      "pose_mae_dtheta": 0.3623453676700592,
      "pose_mae_dx": 0.09786023199558258,
      "pose_mae_dy": 0.07482577860355377,
      "pose_rmse_dtheta": 0.623289942741394,
      "pose_rmse_dx": 0.21716822683811188,
      "pose_rmse_dy": 0.2104564607143402,
      "pose_rmse_mean": 0.35030490159988403,
      "rmse_dtheta": 0.06298461556434631,
      "rmse_dx": 0.025791799649596214,
      "rmse_dy": 0.010051727294921875,
      "rmse_mean": 0.03294271603226662,
      "rotation_flip": 0.009380863048136234,
      "sparse_tokens": 10347.0,
      "step": 11412,
      "turn_loss": 0.2856365144252777,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5302453075636498,
      "grad_norm": 0.5065892934799194,
      "learning_rate": 6.032346995169968e-08,
      "loss": 0.1189,
      "mae_dtheta": 0.007927363738417625,
      "mae_dx": 0.0009141588234342635,
      "mae_dy": 0.0017507796874269843,
      "pose_mae_dtheta": 0.046606745570898056,
      "pose_mae_dx": 0.013093620538711548,
      "pose_mae_dy": 0.018072454258799553,
      "pose_rmse_dtheta": 0.13536036014556885,
      "pose_rmse_dx": 0.035111743956804276,
      "pose_rmse_dy": 0.044797930866479874,
      "pose_rmse_mean": 0.07175667583942413,
      "rmse_dtheta": 0.020668983459472656,
      "rmse_dx": 0.002561206929385662,
      "rmse_dy": 0.003898747731000185,
      "rmse_mean": 0.009042980149388313,
      "rotation_flip": 0.006517311558127403,
      "sparse_tokens": 32105.0,
      "step": 11413,
      "turn_loss": 0.05816516652703285,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3926.0,
      "epoch": 0.5302917673294927,
      "grad_norm": 0.46002790331840515,
      "learning_rate": 6.011887437566421e-08,
      "loss": 0.0841,
      "mae_dtheta": 0.04120473191142082,
      "mae_dx": 0.005305974278599024,
      "mae_dy": 0.002674069721251726,
      "pose_mae_dtheta": 0.33294981718063354,
      "pose_mae_dx": 0.0398457869887352,
      "pose_mae_dy": 0.027862804010510445,
      "pose_rmse_dtheta": 0.5834067463874817,
      "pose_rmse_dx": 0.08090712130069733,
      "pose_rmse_dy": 0.06499498337507248,
      "pose_rmse_mean": 0.24310295283794403,
      "rmse_dtheta": 0.0618327297270298,
      "rmse_dx": 0.013242112472653389,
      "rmse_dy": 0.006118621677160263,
      "rmse_mean": 0.0270644873380661,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 3145.0,
      "step": 11414,
      "turn_loss": 0.2376726269721985,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5303382270953354,
      "grad_norm": 0.5159255266189575,
      "learning_rate": 5.991462424816741e-08,
      "loss": 0.1235,
      "mae_dtheta": 0.008069944567978382,
      "mae_dx": 0.0018764124251902103,
      "mae_dy": 0.0014723404310643673,
      "pose_mae_dtheta": 0.05690934881567955,
      "pose_mae_dx": 0.0200461708009243,
      "pose_mae_dy": 0.021166659891605377,
      "pose_rmse_dtheta": 0.13693660497665405,
      "pose_rmse_dx": 0.05320214107632637,
      "pose_rmse_dy": 0.06088559329509735,
      "pose_rmse_mean": 0.08367478102445602,
      "rmse_dtheta": 0.02084849402308464,
      "rmse_dx": 0.005621307995170355,
      "rmse_dy": 0.003919986076653004,
      "rmse_mean": 0.010129930451512337,
      "rotation_flip": 0.0067862337455153465,
      "sparse_tokens": 32121.0,
      "step": 11415,
      "turn_loss": 0.07528965920209885,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.5303846868611782,
      "grad_norm": 0.5007694959640503,
      "learning_rate": 5.971071958349229e-08,
      "loss": 0.1148,
      "mae_dtheta": 0.02550053410232067,
      "mae_dx": 0.009388983249664307,
      "mae_dy": 0.0029422608204185963,
      "pose_mae_dtheta": 0.19062212109565735,
      "pose_mae_dx": 0.07056916505098343,
      "pose_mae_dy": 0.03586719557642937,
      "pose_rmse_dtheta": 0.3524700105190277,
      "pose_rmse_dx": 0.19231078028678894,
      "pose_rmse_dy": 0.08079199492931366,
      "pose_rmse_mean": 0.20852427184581757,
      "rmse_dtheta": 0.043242353945970535,
      "rmse_dx": 0.021524738520383835,
      "rmse_dy": 0.005782810505479574,
      "rmse_mean": 0.023516636341810226,
      "rotation_flip": 0.012820512987673283,
      "sparse_tokens": 11519.0,
      "step": 11416,
      "turn_loss": 0.21902619302272797,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.530431146627021,
      "grad_norm": 0.31025347113609314,
      "learning_rate": 5.9507160395898544e-08,
      "loss": 0.0681,
      "mae_dtheta": 0.007343053352087736,
      "mae_dx": 0.001278895535506308,
      "mae_dy": 0.0018846627790480852,
      "pose_mae_dtheta": 0.04276622086763382,
      "pose_mae_dx": 0.01790178380906582,
      "pose_mae_dy": 0.019375715404748917,
      "pose_rmse_dtheta": 0.09830916672945023,
      "pose_rmse_dx": 0.04643680155277252,
      "pose_rmse_dy": 0.047126542776823044,
      "pose_rmse_mean": 0.06395751237869263,
      "rmse_dtheta": 0.016843004152178764,
      "rmse_dx": 0.0034514169674366713,
      "rmse_dy": 0.004207659978419542,
      "rmse_mean": 0.008167359977960587,
      "rotation_flip": 0.0025895554572343826,
      "sparse_tokens": 32073.0,
      "step": 11417,
      "turn_loss": 0.05728830397129059,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.5304776063928638,
      "grad_norm": 0.7735410928726196,
      "learning_rate": 5.9303946699620365e-08,
      "loss": 0.1682,
      "mae_dtheta": 0.042962465435266495,
      "mae_dx": 0.015441293828189373,
      "mae_dy": 0.006054217927157879,
      "pose_mae_dtheta": 0.36150476336479187,
      "pose_mae_dx": 0.11519671976566315,
      "pose_mae_dy": 0.06586950272321701,
      "pose_rmse_dtheta": 0.6097821593284607,
      "pose_rmse_dx": 0.24293562769889832,
      "pose_rmse_dy": 0.16280418634414673,
      "pose_rmse_mean": 0.33850735425949097,
      "rmse_dtheta": 0.0626140683889389,
      "rmse_dx": 0.027937576174736023,
      "rmse_dy": 0.013301278464496136,
      "rmse_mean": 0.03461764007806778,
      "rotation_flip": 0.01867816038429737,
      "sparse_tokens": 12555.0,
      "step": 11418,
      "turn_loss": 0.27539458870887756,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5305240661587065,
      "grad_norm": 0.4179224669933319,
      "learning_rate": 5.9101078508869144e-08,
      "loss": 0.085,
      "mae_dtheta": 0.008756576105952263,
      "mae_dx": 0.0013074162416160107,
      "mae_dy": 0.0011114213848486543,
      "pose_mae_dtheta": 0.06180772930383682,
      "pose_mae_dx": 0.010704657062888145,
      "pose_mae_dy": 0.015299727208912373,
      "pose_rmse_dtheta": 0.20137228071689606,
      "pose_rmse_dx": 0.03189271315932274,
      "pose_rmse_dy": 0.044217150658369064,
      "pose_rmse_mean": 0.09249405562877655,
      "rmse_dtheta": 0.025106362998485565,
      "rmse_dx": 0.005431273952126503,
      "rmse_dy": 0.0033494785893708467,
      "rmse_mean": 0.01129570510238409,
      "rotation_flip": 0.0011383038945496082,
      "sparse_tokens": 32089.0,
      "step": 11419,
      "turn_loss": 0.06409505754709244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 41734.0,
      "epoch": 0.5305705259245493,
      "grad_norm": 0.5438053011894226,
      "learning_rate": 5.889855583783133e-08,
      "loss": 0.179,
      "mae_dtheta": 0.03318709880113602,
      "mae_dx": 0.009642896242439747,
      "mae_dy": 0.0037813035305589437,
      "pose_mae_dtheta": 0.26738372445106506,
      "pose_mae_dx": 0.0823306292295456,
      "pose_mae_dy": 0.038368213921785355,
      "pose_rmse_dtheta": 0.48176276683807373,
      "pose_rmse_dx": 0.18360164761543274,
      "pose_rmse_dy": 0.0884735956788063,
      "pose_rmse_mean": 0.251279354095459,
      "rmse_dtheta": 0.052017927169799805,
      "rmse_dx": 0.020739242434501648,
      "rmse_dy": 0.007867791689932346,
      "rmse_mean": 0.02687498740851879,
      "rotation_flip": 0.009396636858582497,
      "sparse_tokens": 30034.0,
      "step": 11420,
      "turn_loss": 0.2529889941215515,
      "turns": 129.0,
      "turns_per_sample": 129.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5306169856903922,
      "grad_norm": 0.4067673087120056,
      "learning_rate": 5.869637870067002e-08,
      "loss": 0.101,
      "mae_dtheta": 0.007050878833979368,
      "mae_dx": 0.001017154660075903,
      "mae_dy": 0.0016001733019948006,
      "pose_mae_dtheta": 0.04665963724255562,
      "pose_mae_dx": 0.01220761239528656,
      "pose_mae_dy": 0.019653785973787308,
      "pose_rmse_dtheta": 0.09887007623910904,
      "pose_rmse_dx": 0.036295335739851,
      "pose_rmse_dy": 0.05397771671414375,
      "pose_rmse_mean": 0.06304770708084106,
      "rmse_dtheta": 0.01498036365956068,
      "rmse_dx": 0.003227979177609086,
      "rmse_dy": 0.003768458729609847,
      "rmse_mean": 0.007325600832700729,
      "rotation_flip": 0.00712060509249568,
      "sparse_tokens": 32073.0,
      "step": 11421,
      "turn_loss": 0.05765571817755699,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5306634454562349,
      "grad_norm": 0.3867485821247101,
      "learning_rate": 5.849454711152225e-08,
      "loss": 0.0708,
      "mae_dtheta": 0.0056411768309772015,
      "mae_dx": 0.0008412171737290919,
      "mae_dy": 0.0008872447651810944,
      "pose_mae_dtheta": 0.03602595999836922,
      "pose_mae_dx": 0.009939397685229778,
      "pose_mae_dy": 0.012577242217957973,
      "pose_rmse_dtheta": 0.1259460747241974,
      "pose_rmse_dx": 0.02398015558719635,
      "pose_rmse_dy": 0.03320145979523659,
      "pose_rmse_mean": 0.06104256212711334,
      "rmse_dtheta": 0.01661757379770279,
      "rmse_dx": 0.002707162406295538,
      "rmse_dy": 0.002234022133052349,
      "rmse_mean": 0.007186252623796463,
      "rotation_flip": 0.0004391743568703532,
      "sparse_tokens": 32137.0,
      "step": 11422,
      "turn_loss": 0.04031720757484436,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5307099052220777,
      "grad_norm": 0.7143722772598267,
      "learning_rate": 5.829306108450339e-08,
      "loss": 0.1784,
      "mae_dtheta": 0.012807205319404602,
      "mae_dx": 0.002066291170194745,
      "mae_dy": 0.003011410590261221,
      "pose_mae_dtheta": 0.08254247158765793,
      "pose_mae_dx": 0.024932831525802612,
      "pose_mae_dy": 0.03295612335205078,
      "pose_rmse_dtheta": 0.1959582269191742,
      "pose_rmse_dx": 0.06371384114027023,
      "pose_rmse_dy": 0.07841413468122482,
      "pose_rmse_mean": 0.11269541084766388,
      "rmse_dtheta": 0.024600455537438393,
      "rmse_dx": 0.00827318150550127,
      "rmse_dy": 0.00737871415913105,
      "rmse_mean": 0.013417450711131096,
      "rotation_flip": 0.007387508172541857,
      "sparse_tokens": 32089.0,
      "step": 11423,
      "turn_loss": 0.1194583848118782,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5307563649879204,
      "grad_norm": 0.31389835476875305,
      "learning_rate": 5.809192063370384e-08,
      "loss": 0.0933,
      "mae_dtheta": 0.008147744461894035,
      "mae_dx": 0.002037342404946685,
      "mae_dy": 0.0023385542444884777,
      "pose_mae_dtheta": 0.05447133630514145,
      "pose_mae_dx": 0.021217133849859238,
      "pose_mae_dy": 0.022483494132757187,
      "pose_rmse_dtheta": 0.13278202712535858,
      "pose_rmse_dx": 0.09040128439664841,
      "pose_rmse_dy": 0.05860588327050209,
      "pose_rmse_mean": 0.0939297303557396,
      "rmse_dtheta": 0.017078597098588943,
      "rmse_dx": 0.006716330535709858,
      "rmse_dy": 0.007317765150219202,
      "rmse_mean": 0.010370897129178047,
      "rotation_flip": 0.007456828840076923,
      "sparse_tokens": 32153.0,
      "step": 11424,
      "turn_loss": 0.06964678317308426,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5308028247537633,
      "grad_norm": 0.46792736649513245,
      "learning_rate": 5.7891125773187896e-08,
      "loss": 0.0951,
      "mae_dtheta": 0.006736979819834232,
      "mae_dx": 0.0010320738656446338,
      "mae_dy": 0.0007313001551665366,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4679274260997772,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 163.6840362548828,
      "model/head/act_norm_mean": 124.2423551925505,
      "model/head/act_norm_min": 81.19522094726562,
      "model/head/act_over_embed": 85.38050966357615,
      "model/head/grad_frac": 0.07920925319194794,
      "model/head/grad_norm": 0.03706418350338936,
      "model/head/grad_zero_frac": 0.00020051575847901404,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7007329150883839,
      "model/head/update_ratio": 0.0006309350137598813,
      "model/head/weight_delta": 9.985291481018066,
      "model/head/weight_delta_rel": 0.17517158389091492,
      "model/head/weight_norm": 58.744850158691406,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229320287704468,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42286817762586804,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42279449105262756,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905989706187498,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1014588251709938,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04747536778450012,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5384027777777778,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0015329541638493538,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1567084789276123,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10313950479030609,
      "model/modality_embedder.encoders.pose/weight_norm": 30.9698543548584,
      "model/modality_embedder/grad_frac": 0.1014588251709938,
      "model/modality_embedder/grad_norm": 0.04747536778450012,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5384027777777778,
      "model/modality_embedder/update_ratio": 0.0015329541638493538,
      "model/modality_embedder/weight_delta": 3.1567084789276123,
      "model/modality_embedder/weight_delta_rel": 0.10313950479030609,
      "model/modality_embedder/weight_norm": 30.9698543548584,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.03380584716797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.972124518999518,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.010149002075195,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.16107776216968,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05445774644613266,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02548227272927761,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009113448904827237,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7424418926239014,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09993623942136765,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96117401123047,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.03237915039062,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.94856551627385,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.154192924499512,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.832097157081243,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05488128215074539,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.025680456310510635,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008626050548627973,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.477074384689331,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12044857442378998,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770816802978516,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.56684875488281,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.75483505691839,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.01474666595459,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.073382495974045,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.05455125495791435,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.025526028126478195,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008303203503601253,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.767014503479004,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1264892965555191,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742385864257812,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.12254333496094,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.38423921757255,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.175874710083008,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.193124289897675,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05181104689836502,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.024243809282779694,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008093233918771148,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.23811674118042,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11066346615552902,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955652236938477,
      "model/normalizer/grad_frac": 0.1768924444913864,
      "model/normalizer/grad_norm": 0.08277282863855362,
      "model/normalizer/grad_zero_frac": 0.000252892030403018,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010523133678361773,
      "model/normalizer/weight_delta": 6.809668064117432,
      "model/normalizer/weight_delta_rel": 0.08770458400249481,
      "model/normalizer/weight_norm": 78.65796661376953,
      "pose_mae_dtheta": 0.047003477811813354,
      "pose_mae_dx": 0.01111680269241333,
      "pose_mae_dy": 0.011501099914312363,
      "pose_rmse_dtheta": 0.19193677604198456,
      "pose_rmse_dx": 0.0266573429107666,
      "pose_rmse_dy": 0.03268696740269661,
      "pose_rmse_mean": 0.08376036584377289,
      "rmse_dtheta": 0.022542595863342285,
      "rmse_dx": 0.003293766174465418,
      "rmse_dy": 0.0017776694148778915,
      "rmse_mean": 0.009204677306115627,
      "rotation_flip": 0.0,
      "sparse_tokens": 32121.0,
      "step": 11425,
      "turn_loss": 0.050259463489055634,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.530849284519606,
      "grad_norm": 0.6364931464195251,
      "learning_rate": 5.769067651699878e-08,
      "loss": 0.1129,
      "mae_dtheta": 0.009332962334156036,
      "mae_dx": 0.0019906945526599884,
      "mae_dy": 0.002010779455304146,
      "pose_mae_dtheta": 0.06409067660570145,
      "pose_mae_dx": 0.02306564897298813,
      "pose_mae_dy": 0.02074211835861206,
      "pose_rmse_dtheta": 0.17743659019470215,
      "pose_rmse_dx": 0.06041017919778824,
      "pose_rmse_dy": 0.04830942675471306,
      "pose_rmse_mean": 0.09538539499044418,
      "rmse_dtheta": 0.021605554968118668,
      "rmse_dx": 0.006013754289597273,
      "rmse_dy": 0.004506080411374569,
      "rmse_mean": 0.010708464309573174,
      "rotation_flip": 0.0022862369660288095,
      "sparse_tokens": 32073.0,
      "step": 11426,
      "turn_loss": 0.07503462582826614,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.5308957442854488,
      "grad_norm": 0.4368402361869812,
      "learning_rate": 5.749057287915305e-08,
      "loss": 0.1026,
      "mae_dtheta": 0.031431250274181366,
      "mae_dx": 0.009110702201724052,
      "mae_dy": 0.00510820047929883,
      "pose_mae_dtheta": 0.23125644028186798,
      "pose_mae_dx": 0.0689842700958252,
      "pose_mae_dy": 0.05846870318055153,
      "pose_rmse_dtheta": 0.41491806507110596,
      "pose_rmse_dx": 0.15746858716011047,
      "pose_rmse_dy": 0.15038204193115234,
      "pose_rmse_mean": 0.24092289805412292,
      "rmse_dtheta": 0.049645163118839264,
      "rmse_dx": 0.01995716616511345,
      "rmse_dy": 0.010485348291695118,
      "rmse_mean": 0.026695892214775085,
      "rotation_flip": 0.018651362508535385,
      "sparse_tokens": 11362.0,
      "step": 11427,
      "turn_loss": 0.2610865831375122,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.5309422040512916,
      "grad_norm": 0.5893299579620361,
      "learning_rate": 5.729081487364396e-08,
      "loss": 0.1577,
      "mae_dtheta": 0.04501446336507797,
      "mae_dx": 0.012410017661750317,
      "mae_dy": 0.0039320471696555614,
      "pose_mae_dtheta": 0.36206457018852234,
      "pose_mae_dx": 0.09770052134990692,
      "pose_mae_dy": 0.0432763397693634,
      "pose_rmse_dtheta": 0.6247754693031311,
      "pose_rmse_dx": 0.22081567347049713,
      "pose_rmse_dy": 0.127033069729805,
      "pose_rmse_mean": 0.3242080807685852,
      "rmse_dtheta": 0.06530044972896576,
      "rmse_dx": 0.024654658511281013,
      "rmse_dy": 0.009362345561385155,
      "rmse_mean": 0.033105820417404175,
      "rotation_flip": 0.022284122183918953,
      "sparse_tokens": 12185.0,
      "step": 11428,
      "turn_loss": 0.28445345163345337,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5309886638171344,
      "grad_norm": 0.37911155819892883,
      "learning_rate": 5.709140251444201e-08,
      "loss": 0.0818,
      "mae_dtheta": 0.006071704439818859,
      "mae_dx": 0.0008356603793799877,
      "mae_dy": 0.0012575075961649418,
      "pose_mae_dtheta": 0.03453834354877472,
      "pose_mae_dx": 0.008609475567936897,
      "pose_mae_dy": 0.016729842871427536,
      "pose_rmse_dtheta": 0.0632067546248436,
      "pose_rmse_dx": 0.019835984334349632,
      "pose_rmse_dy": 0.03854621946811676,
      "pose_rmse_mean": 0.040529653429985046,
      "rmse_dtheta": 0.011239140294492245,
      "rmse_dx": 0.002464740304276347,
      "rmse_dy": 0.0025512289721518755,
      "rmse_mean": 0.0054183704778552055,
      "rotation_flip": 0.005187106318771839,
      "sparse_tokens": 32137.0,
      "step": 11429,
      "turn_loss": 0.04519650340080261,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18772.0,
      "epoch": 0.5310351235829771,
      "grad_norm": 0.4800131320953369,
      "learning_rate": 5.6892335815490474e-08,
      "loss": 0.1298,
      "mae_dtheta": 0.04422254115343094,
      "mae_dx": 0.012426741421222687,
      "mae_dy": 0.006258461624383926,
      "pose_mae_dtheta": 0.38488852977752686,
      "pose_mae_dx": 0.09316080063581467,
      "pose_mae_dy": 0.06217706575989723,
      "pose_rmse_dtheta": 0.6577216386795044,
      "pose_rmse_dx": 0.1847490668296814,
      "pose_rmse_dy": 0.16213193535804749,
      "pose_rmse_mean": 0.33486756682395935,
      "rmse_dtheta": 0.06530869752168655,
      "rmse_dx": 0.02303362265229225,
      "rmse_dy": 0.014837592840194702,
      "rmse_mean": 0.0343933068215847,
      "rotation_flip": 0.00821596197783947,
      "sparse_tokens": 14902.0,
      "step": 11430,
      "turn_loss": 0.3185316324234009,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 33958.0,
      "epoch": 0.5310815833488199,
      "grad_norm": 0.6279899477958679,
      "learning_rate": 5.669361479071156e-08,
      "loss": 0.197,
      "mae_dtheta": 0.041037339717149734,
      "mae_dx": 0.012222147546708584,
      "mae_dy": 0.0058492072857916355,
      "pose_mae_dtheta": 0.3265109658241272,
      "pose_mae_dx": 0.10431778430938721,
      "pose_mae_dy": 0.06183449178934097,
      "pose_rmse_dtheta": 0.5478342175483704,
      "pose_rmse_dx": 0.21353699266910553,
      "pose_rmse_dy": 0.14517603814601898,
      "pose_rmse_mean": 0.3021824359893799,
      "rmse_dtheta": 0.05943826213479042,
      "rmse_dx": 0.02367519587278366,
      "rmse_dy": 0.012698029167950153,
      "rmse_mean": 0.031937167048454285,
      "rotation_flip": 0.016424510627985,
      "sparse_tokens": 28116.0,
      "step": 11431,
      "turn_loss": 0.31075340509414673,
      "turns": 105.0,
      "turns_per_sample": 105.0
    },
    {
      "dense_tokens": 5206.0,
      "epoch": 0.5311280431146627,
      "grad_norm": 0.6197923421859741,
      "learning_rate": 5.6495239454000816e-08,
      "loss": 0.1448,
      "mae_dtheta": 0.03535982966423035,
      "mae_dx": 0.006440967321395874,
      "mae_dy": 0.004916289355605841,
      "pose_mae_dtheta": 0.3315466344356537,
      "pose_mae_dx": 0.05159682035446167,
      "pose_mae_dy": 0.048196177929639816,
      "pose_rmse_dtheta": 0.6239544749259949,
      "pose_rmse_dx": 0.12085188925266266,
      "pose_rmse_dy": 0.10855124145746231,
      "pose_rmse_mean": 0.28445255756378174,
      "rmse_dtheta": 0.058479808270931244,
      "rmse_dx": 0.013341309502720833,
      "rmse_dy": 0.008543172851204872,
      "rmse_mean": 0.026788096874952316,
      "rotation_flip": 0.012048192322254181,
      "sparse_tokens": 4165.0,
      "step": 11432,
      "turn_loss": 0.23993442952632904,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.5311745028805055,
      "grad_norm": 0.7109711170196533,
      "learning_rate": 5.629720981923214e-08,
      "loss": 0.1631,
      "mae_dtheta": 0.027042249217629433,
      "mae_dx": 0.007089016959071159,
      "mae_dy": 0.0034348703920841217,
      "pose_mae_dtheta": 0.18513759970664978,
      "pose_mae_dx": 0.05624440312385559,
      "pose_mae_dy": 0.0301772840321064,
      "pose_rmse_dtheta": 0.3150307536125183,
      "pose_rmse_dx": 0.12858985364437103,
      "pose_rmse_dy": 0.06686615943908691,
      "pose_rmse_mean": 0.17016226053237915,
      "rmse_dtheta": 0.04271223023533821,
      "rmse_dx": 0.0163147933781147,
      "rmse_dy": 0.007819903083145618,
      "rmse_mean": 0.02228230983018875,
      "rotation_flip": 0.012912482023239136,
      "sparse_tokens": 11303.0,
      "step": 11433,
      "turn_loss": 0.21161611378192902,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 7146.0,
      "epoch": 0.5312209626463482,
      "grad_norm": 0.5794840455055237,
      "learning_rate": 5.609952590025225e-08,
      "loss": 0.102,
      "mae_dtheta": 0.03642221540212631,
      "mae_dx": 0.01866406388580799,
      "mae_dy": 0.005050394218415022,
      "pose_mae_dtheta": 0.2868918478488922,
      "pose_mae_dx": 0.13761590421199799,
      "pose_mae_dy": 0.06000980734825134,
      "pose_rmse_dtheta": 0.4412839412689209,
      "pose_rmse_dx": 0.2781963050365448,
      "pose_rmse_dy": 0.13298723101615906,
      "pose_rmse_mean": 0.28415584564208984,
      "rmse_dtheta": 0.04938072711229324,
      "rmse_dx": 0.03263631835579872,
      "rmse_dy": 0.009193704463541508,
      "rmse_mean": 0.030403584241867065,
      "rotation_flip": 0.0059523810632526875,
      "sparse_tokens": 5956.0,
      "step": 11434,
      "turn_loss": 0.2731516659259796,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.531267422412191,
      "grad_norm": 0.5572894811630249,
      "learning_rate": 5.590218771088674e-08,
      "loss": 0.1108,
      "mae_dtheta": 0.02847478911280632,
      "mae_dx": 0.00937721598893404,
      "mae_dy": 0.0049893236719071865,
      "pose_mae_dtheta": 0.2390885204076767,
      "pose_mae_dx": 0.062171969562768936,
      "pose_mae_dy": 0.06063546612858772,
      "pose_rmse_dtheta": 0.5050709843635559,
      "pose_rmse_dx": 0.14714255928993225,
      "pose_rmse_dy": 0.16200144588947296,
      "pose_rmse_mean": 0.27140501141548157,
      "rmse_dtheta": 0.048902347683906555,
      "rmse_dx": 0.021194808185100555,
      "rmse_dy": 0.011530189774930477,
      "rmse_mean": 0.027209116145968437,
      "rotation_flip": 0.002463054144755006,
      "sparse_tokens": 7025.0,
      "step": 11435,
      "turn_loss": 0.1796889454126358,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.5313138821780338,
      "grad_norm": 1.7359273433685303,
      "learning_rate": 5.570519526493456e-08,
      "loss": 0.3052,
      "mae_dtheta": 0.045248012989759445,
      "mae_dx": 0.010372231714427471,
      "mae_dy": 0.011271057650446892,
      "pose_mae_dtheta": 0.3739836513996124,
      "pose_mae_dx": 0.062444671988487244,
      "pose_mae_dy": 0.12333955615758896,
      "pose_rmse_dtheta": 0.5286821722984314,
      "pose_rmse_dx": 0.10984848439693451,
      "pose_rmse_dy": 0.28258514404296875,
      "pose_rmse_mean": 0.3070386052131653,
      "rmse_dtheta": 0.06075522303581238,
      "rmse_dx": 0.019040441140532494,
      "rmse_dy": 0.024112949147820473,
      "rmse_mean": 0.034636206924915314,
      "rotation_flip": 0.017182130366563797,
      "sparse_tokens": 4672.0,
      "step": 11436,
      "turn_loss": 0.4677135646343231,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.5313603419438766,
      "grad_norm": 0.34257256984710693,
      "learning_rate": 5.550854857617194e-08,
      "loss": 0.0921,
      "mae_dtheta": 0.03108159825205803,
      "mae_dx": 0.0097531508654356,
      "mae_dy": 0.005137961357831955,
      "pose_mae_dtheta": 0.2407422661781311,
      "pose_mae_dx": 0.08088613301515579,
      "pose_mae_dy": 0.06428452581167221,
      "pose_rmse_dtheta": 0.4486447274684906,
      "pose_rmse_dx": 0.18024007976055145,
      "pose_rmse_dy": 0.14129017293453217,
      "pose_rmse_mean": 0.256725013256073,
      "rmse_dtheta": 0.04908304661512375,
      "rmse_dx": 0.02167433872818947,
      "rmse_dy": 0.009490269236266613,
      "rmse_mean": 0.026749219745397568,
      "rotation_flip": 0.0063091483898460865,
      "sparse_tokens": 22428.0,
      "step": 11437,
      "turn_loss": 0.24317578971385956,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 30173.0,
      "epoch": 0.5314068017097194,
      "grad_norm": 0.5640071630477905,
      "learning_rate": 5.5312247658350636e-08,
      "loss": 0.1751,
      "mae_dtheta": 0.03602125868201256,
      "mae_dx": 0.008431964553892612,
      "mae_dy": 0.004167297389358282,
      "pose_mae_dtheta": 0.278948038816452,
      "pose_mae_dx": 0.0720280259847641,
      "pose_mae_dy": 0.041426584124565125,
      "pose_rmse_dtheta": 0.4957348704338074,
      "pose_rmse_dx": 0.16628344357013702,
      "pose_rmse_dy": 0.09750363230705261,
      "pose_rmse_mean": 0.2531740069389343,
      "rmse_dtheta": 0.05580796301364899,
      "rmse_dx": 0.019144784659147263,
      "rmse_dy": 0.01025240495800972,
      "rmse_mean": 0.02840171754360199,
      "rotation_flip": 0.011220196262001991,
      "sparse_tokens": 21040.0,
      "step": 11438,
      "turn_loss": 0.30069097876548767,
      "turns": 93.0,
      "turns_per_sample": 93.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5314532614755622,
      "grad_norm": 0.3978692889213562,
      "learning_rate": 5.51162925251969e-08,
      "loss": 0.0699,
      "mae_dtheta": 0.007601735647767782,
      "mae_dx": 0.0014801645884290338,
      "mae_dy": 0.0018071637023240328,
      "pose_mae_dtheta": 0.05038096383213997,
      "pose_mae_dx": 0.01609048619866371,
      "pose_mae_dy": 0.0196636151522398,
      "pose_rmse_dtheta": 0.1519252508878708,
      "pose_rmse_dx": 0.051098015159368515,
      "pose_rmse_dy": 0.04974910989403725,
      "pose_rmse_mean": 0.08425746858119965,
      "rmse_dtheta": 0.019778650254011154,
      "rmse_dx": 0.00528364535421133,
      "rmse_dy": 0.004705740604549646,
      "rmse_mean": 0.009922679513692856,
      "rotation_flip": 0.006775832735002041,
      "sparse_tokens": 32057.0,
      "step": 11439,
      "turn_loss": 0.05960553139448166,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13604.0,
      "epoch": 0.531499721241405,
      "grad_norm": 0.5684558153152466,
      "learning_rate": 5.492068319041588e-08,
      "loss": 0.1488,
      "mae_dtheta": 0.028919070959091187,
      "mae_dx": 0.008372180163860321,
      "mae_dy": 0.006507745012640953,
      "pose_mae_dtheta": 0.20949934422969818,
      "pose_mae_dx": 0.05976863205432892,
      "pose_mae_dy": 0.06940007209777832,
      "pose_rmse_dtheta": 0.38775521516799927,
      "pose_rmse_dx": 0.13627366721630096,
      "pose_rmse_dy": 0.15753674507141113,
      "pose_rmse_mean": 0.22718855738639832,
      "rmse_dtheta": 0.04668647423386574,
      "rmse_dx": 0.018069934099912643,
      "rmse_dy": 0.012752403505146503,
      "rmse_mean": 0.025836272165179253,
      "rotation_flip": 0.009900989942252636,
      "sparse_tokens": 10407.0,
      "step": 11440,
      "turn_loss": 0.2678396999835968,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 8463.0,
      "epoch": 0.5315461810072477,
      "grad_norm": 0.5858347415924072,
      "learning_rate": 5.472541966768552e-08,
      "loss": 0.1049,
      "mae_dtheta": 0.014589228667318821,
      "mae_dx": 0.005852047819644213,
      "mae_dy": 0.003611065447330475,
      "pose_mae_dtheta": 0.11381547152996063,
      "pose_mae_dx": 0.046749502420425415,
      "pose_mae_dy": 0.06249025836586952,
      "pose_rmse_dtheta": 0.21554911136627197,
      "pose_rmse_dx": 0.1368558555841446,
      "pose_rmse_dy": 0.15156997740268707,
      "pose_rmse_mean": 0.16799163818359375,
      "rmse_dtheta": 0.02694750390946865,
      "rmse_dx": 0.01749430224299431,
      "rmse_dy": 0.007126122713088989,
      "rmse_mean": 0.017189309000968933,
      "rotation_flip": 0.004975124262273312,
      "sparse_tokens": 6463.0,
      "step": 11441,
      "turn_loss": 0.1375785768032074,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.5315926407730905,
      "grad_norm": 0.42859402298927307,
      "learning_rate": 5.4530501970660453e-08,
      "loss": 0.0909,
      "mae_dtheta": 0.008219755254685879,
      "mae_dx": 0.001418384606949985,
      "mae_dy": 0.00020634903921745718,
      "pose_mae_dtheta": 0.0567648820579052,
      "pose_mae_dx": 0.010842709802091122,
      "pose_mae_dy": 0.002345537068322301,
      "pose_rmse_dtheta": 0.2517619729042053,
      "pose_rmse_dx": 0.030307846143841743,
      "pose_rmse_dy": 0.0046323202550411224,
      "pose_rmse_mean": 0.09556739032268524,
      "rmse_dtheta": 0.03039630502462387,
      "rmse_dx": 0.00410672789439559,
      "rmse_dy": 0.0004586587310768664,
      "rmse_mean": 0.011653896421194077,
      "rotation_flip": 0.0022160664666444063,
      "sparse_tokens": 32249.0,
      "step": 11442,
      "turn_loss": 0.04782221093773842,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5316391005389333,
      "grad_norm": 0.335957795381546,
      "learning_rate": 5.4335930112972e-08,
      "loss": 0.0786,
      "mae_dtheta": 0.008308900520205498,
      "mae_dx": 0.0015178484609350562,
      "mae_dy": 0.0023307388182729483,
      "pose_mae_dtheta": 0.055423252284526825,
      "pose_mae_dx": 0.01765027828514576,
      "pose_mae_dy": 0.02364329621195793,
      "pose_rmse_dtheta": 0.12900444865226746,
      "pose_rmse_dx": 0.049452684819698334,
      "pose_rmse_dy": 0.050753653049468994,
      "pose_rmse_mean": 0.07640360295772552,
      "rmse_dtheta": 0.017464205622673035,
      "rmse_dx": 0.004365550819784403,
      "rmse_dy": 0.005219918210059404,
      "rmse_mean": 0.009016558527946472,
      "rotation_flip": 0.004959939047694206,
      "sparse_tokens": 32105.0,
      "step": 11443,
      "turn_loss": 0.06741084158420563,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64649.0,
      "epoch": 0.5316855603047761,
      "grad_norm": 0.4038921892642975,
      "learning_rate": 5.41417041082265e-08,
      "loss": 0.0809,
      "mae_dtheta": 0.007998687215149403,
      "mae_dx": 0.0015954221598803997,
      "mae_dy": 0.00040087205707095563,
      "pose_mae_dtheta": 0.05479177087545395,
      "pose_mae_dx": 0.011601180769503117,
      "pose_mae_dy": 0.0041453540325164795,
      "pose_rmse_dtheta": 0.22055676579475403,
      "pose_rmse_dx": 0.03191631659865379,
      "pose_rmse_dy": 0.01234948169440031,
      "pose_rmse_mean": 0.08827419579029083,
      "rmse_dtheta": 0.028271757066249847,
      "rmse_dx": 0.004770839586853981,
      "rmse_dy": 0.0013910996494814754,
      "rmse_mean": 0.011477897875010967,
      "rotation_flip": 0.0010537407360970974,
      "sparse_tokens": 32249.0,
      "step": 11444,
      "turn_loss": 0.04617578163743019,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.5317320200706188,
      "grad_norm": 0.4575297236442566,
      "learning_rate": 5.3947823970006416e-08,
      "loss": 0.1125,
      "mae_dtheta": 0.032361265271902084,
      "mae_dx": 0.012661551125347614,
      "mae_dy": 0.0037947276141494513,
      "pose_mae_dtheta": 0.23776771128177643,
      "pose_mae_dx": 0.10837198048830032,
      "pose_mae_dy": 0.05236055701971054,
      "pose_rmse_dtheta": 0.3987356126308441,
      "pose_rmse_dx": 0.24513013660907745,
      "pose_rmse_dy": 0.11272711306810379,
      "pose_rmse_mean": 0.25219762325286865,
      "rmse_dtheta": 0.04952167719602585,
      "rmse_dx": 0.02570800483226776,
      "rmse_dy": 0.006452350877225399,
      "rmse_mean": 0.02722734585404396,
      "rotation_flip": 0.008547008968889713,
      "sparse_tokens": 8992.0,
      "step": 11445,
      "turn_loss": 0.230271115899086,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5317784798364616,
      "grad_norm": 0.4800257682800293,
      "learning_rate": 5.375428971186925e-08,
      "loss": 0.101,
      "mae_dtheta": 0.011457175016403198,
      "mae_dx": 0.0015989876119419932,
      "mae_dy": 0.0028289544861763716,
      "pose_mae_dtheta": 0.07130950689315796,
      "pose_mae_dx": 0.02362631820142269,
      "pose_mae_dy": 0.032322466373443604,
      "pose_rmse_dtheta": 0.17358365654945374,
      "pose_rmse_dx": 0.06380672752857208,
      "pose_rmse_dy": 0.087941974401474,
      "pose_rmse_mean": 0.10844411700963974,
      "rmse_dtheta": 0.02308710291981697,
      "rmse_dx": 0.004269108641892672,
      "rmse_dy": 0.006029490381479263,
      "rmse_mean": 0.011128567159175873,
      "rotation_flip": 0.005197505000978708,
      "sparse_tokens": 32089.0,
      "step": 11446,
      "turn_loss": 0.10430711507797241,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.5318249396023044,
      "grad_norm": 0.5774385929107666,
      "learning_rate": 5.356110134734971e-08,
      "loss": 0.1082,
      "mae_dtheta": 0.02958598919212818,
      "mae_dx": 0.00803404301404953,
      "mae_dy": 0.00491253100335598,
      "pose_mae_dtheta": 0.2239898145198822,
      "pose_mae_dx": 0.061901647597551346,
      "pose_mae_dy": 0.06396152079105377,
      "pose_rmse_dtheta": 0.4443262219429016,
      "pose_rmse_dx": 0.1448599100112915,
      "pose_rmse_dy": 0.15950097143650055,
      "pose_rmse_mean": 0.2495623677968979,
      "rmse_dtheta": 0.04942614957690239,
      "rmse_dx": 0.019138755276799202,
      "rmse_dy": 0.009537518955767155,
      "rmse_mean": 0.026034142822027206,
      "rotation_flip": 0.013245033100247383,
      "sparse_tokens": 16585.0,
      "step": 11447,
      "turn_loss": 0.19279912114143372,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.5318713993681472,
      "grad_norm": 0.5627286434173584,
      "learning_rate": 5.336825888995756e-08,
      "loss": 0.1136,
      "mae_dtheta": 0.033809516578912735,
      "mae_dx": 0.013158171437680721,
      "mae_dy": 0.005266160704195499,
      "pose_mae_dtheta": 0.255550354719162,
      "pose_mae_dx": 0.12363465875387192,
      "pose_mae_dy": 0.0551133006811142,
      "pose_rmse_dtheta": 0.45098790526390076,
      "pose_rmse_dx": 0.2543522119522095,
      "pose_rmse_dy": 0.18587547540664673,
      "pose_rmse_mean": 0.2970718741416931,
      "rmse_dtheta": 0.053173765540122986,
      "rmse_dx": 0.026199109852313995,
      "rmse_dy": 0.015935346484184265,
      "rmse_mean": 0.03176940977573395,
      "rotation_flip": 0.01383125875145197,
      "sparse_tokens": 13867.0,
      "step": 11448,
      "turn_loss": 0.317186176776886,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5319178591339899,
      "grad_norm": 0.6353136897087097,
      "learning_rate": 5.3175762353177563e-08,
      "loss": 0.1552,
      "mae_dtheta": 0.008265020325779915,
      "mae_dx": 0.0021322965621948242,
      "mae_dy": 0.0008931108168326318,
      "pose_mae_dtheta": 0.060883961617946625,
      "pose_mae_dx": 0.02000511810183525,
      "pose_mae_dy": 0.0124872587621212,
      "pose_rmse_dtheta": 0.23405605554580688,
      "pose_rmse_dx": 0.06694704294204712,
      "pose_rmse_dy": 0.0386628694832325,
      "pose_rmse_mean": 0.11322199553251266,
      "rmse_dtheta": 0.026328805834054947,
      "rmse_dx": 0.007395595777779818,
      "rmse_dy": 0.0029338174499571323,
      "rmse_mean": 0.01221940666437149,
      "rotation_flip": 0.0024370430037379265,
      "sparse_tokens": 32041.0,
      "step": 11449,
      "turn_loss": 0.06414526700973511,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5319643188998328,
      "grad_norm": 0.42283448576927185,
      "learning_rate": 5.298361175047173e-08,
      "loss": 0.1193,
      "mae_dtheta": 0.009909514337778091,
      "mae_dx": 0.0019111311994493008,
      "mae_dy": 0.0021582620684057474,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4228344261646271,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 166.39707946777344,
      "model/head/act_norm_mean": 109.39054608585859,
      "model/head/act_norm_min": 54.18928909301758,
      "model/head/act_over_embed": 75.17420740062991,
      "model/head/grad_frac": 0.13030697405338287,
      "model/head/grad_norm": 0.0550982728600502,
      "model/head/grad_zero_frac": 0.00019004578643944114,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7115885416666666,
      "model/head/update_ratio": 0.0009379250113852322,
      "model/head/weight_delta": 9.985406875610352,
      "model/head/weight_delta_rel": 0.17517361044883728,
      "model/head/weight_norm": 58.74485778808594,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229409098625183,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228684385800691,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227916896343231,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905991499489199,
      "model/modality_embedder.encoders.pose/grad_frac": 0.075990691781044,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03213148191571236,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5299809187788018,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001037508132867515,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1567866802215576,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314206033945084,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969860076904297,
      "model/modality_embedder/grad_frac": 0.075990691781044,
      "model/modality_embedder/grad_norm": 0.03213148191571236,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5299809187788018,
      "model/modality_embedder/update_ratio": 0.001037508132867515,
      "model/modality_embedder/weight_delta": 3.1567866802215576,
      "model/modality_embedder/weight_delta_rel": 0.10314206033945084,
      "model/modality_embedder/weight_norm": 30.969860076904297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 93.10052490234375,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.489202541285874,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.995375633239746,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.141999895750573,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07990118116140366,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03378497064113617,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0012082812609151006,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.742511510848999,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0999387726187706,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961181640625,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 94.37169647216797,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.431484988776656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.08887004852295,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.7895452154535,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09213456511497498,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03895766660571098,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0013085847022011876,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4771568775177,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1204514354467392,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77083969116211,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.86221313476562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.202536275452943,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.344402313232422,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.006628240500827,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08987609297037125,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.038002707064151764,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012361658737063408,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7671005725860596,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1264921873807907,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742401123046875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.28242492675781,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.91108756212923,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.28557014465332,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.180760680413933,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.09520740807056427,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04025696963071823,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013438852038234472,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2381882667541504,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11066590994596481,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95566177368164,
      "model/normalizer/grad_frac": 0.38195258378982544,
      "model/normalizer/grad_norm": 0.16150270402431488,
      "model/normalizer/grad_zero_frac": 0.00021034943347331136,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0020532270427793264,
      "model/normalizer/weight_delta": 6.809828281402588,
      "model/normalizer/weight_delta_rel": 0.08770664781332016,
      "model/normalizer/weight_norm": 78.65798950195312,
      "pose_mae_dtheta": 0.06750334054231644,
      "pose_mae_dx": 0.021481502801179886,
      "pose_mae_dy": 0.024983210489153862,
      "pose_rmse_dtheta": 0.17216625809669495,
      "pose_rmse_dx": 0.06748892366886139,
      "pose_rmse_dy": 0.06666142493486404,
      "pose_rmse_mean": 0.10210554301738739,
      "rmse_dtheta": 0.022626318037509918,
      "rmse_dx": 0.006414748728275299,
      "rmse_dy": 0.005338286515325308,
      "rmse_mean": 0.01145978458225727,
      "rotation_flip": 0.008244423195719719,
      "sparse_tokens": 32057.0,
      "step": 11450,
      "turn_loss": 0.08676182478666306,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19478.0,
      "epoch": 0.5320107786656755,
      "grad_norm": 0.47309350967407227,
      "learning_rate": 5.279180709527765e-08,
      "loss": 0.1195,
      "mae_dtheta": 0.031597331166267395,
      "mae_dx": 0.011889646761119366,
      "mae_dy": 0.0050656492821872234,
      "pose_mae_dtheta": 0.24590523540973663,
      "pose_mae_dx": 0.09197680652141571,
      "pose_mae_dy": 0.04651938006281853,
      "pose_rmse_dtheta": 0.44656461477279663,
      "pose_rmse_dx": 0.20504230260849,
      "pose_rmse_dy": 0.09579890966415405,
      "pose_rmse_mean": 0.24913528561592102,
      "rmse_dtheta": 0.05046635493636131,
      "rmse_dx": 0.02370636723935604,
      "rmse_dy": 0.010649045929312706,
      "rmse_mean": 0.028273923322558403,
      "rotation_flip": 0.009544008411467075,
      "sparse_tokens": 15370.0,
      "step": 11451,
      "turn_loss": 0.2357618361711502,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.5320572384315183,
      "grad_norm": 0.5244043469429016,
      "learning_rate": 5.260034840100736e-08,
      "loss": 0.1543,
      "mae_dtheta": 0.04115021973848343,
      "mae_dx": 0.01462298259139061,
      "mae_dy": 0.0036826846189796925,
      "pose_mae_dtheta": 0.32751595973968506,
      "pose_mae_dx": 0.12589026987552643,
      "pose_mae_dy": 0.046260859817266464,
      "pose_rmse_dtheta": 0.5462327003479004,
      "pose_rmse_dx": 0.2601875960826874,
      "pose_rmse_dy": 0.10973551124334335,
      "pose_rmse_mean": 0.3053852915763855,
      "rmse_dtheta": 0.05989193916320801,
      "rmse_dx": 0.027006592601537704,
      "rmse_dy": 0.008013173937797546,
      "rmse_mean": 0.03163723647594452,
      "rotation_flip": 0.018018018454313278,
      "sparse_tokens": 17540.0,
      "step": 11452,
      "turn_loss": 0.3038267195224762,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.532103698197361,
      "grad_norm": 0.48550790548324585,
      "learning_rate": 5.2409235681050166e-08,
      "loss": 0.1276,
      "mae_dtheta": 0.005806616973131895,
      "mae_dx": 0.0013524733949452639,
      "mae_dy": 0.0011094739893451333,
      "pose_mae_dtheta": 0.04090486466884613,
      "pose_mae_dx": 0.0138948829844594,
      "pose_mae_dy": 0.01632658578455448,
      "pose_rmse_dtheta": 0.11777742207050323,
      "pose_rmse_dx": 0.03987831622362137,
      "pose_rmse_dy": 0.043636828660964966,
      "pose_rmse_mean": 0.06709752976894379,
      "rmse_dtheta": 0.015000692568719387,
      "rmse_dx": 0.004940343555063009,
      "rmse_dy": 0.003227866254746914,
      "rmse_mean": 0.007722967769950628,
      "rotation_flip": 0.0018587360391393304,
      "sparse_tokens": 32073.0,
      "step": 11453,
      "turn_loss": 0.049829911440610886,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5321501579632039,
      "grad_norm": 0.5024073719978333,
      "learning_rate": 5.221846894877092e-08,
      "loss": 0.0835,
      "mae_dtheta": 0.003377040382474661,
      "mae_dx": 0.0005826489068567753,
      "mae_dy": 0.0006389794871211052,
      "pose_mae_dtheta": 0.02355681173503399,
      "pose_mae_dx": 0.006502103991806507,
      "pose_mae_dy": 0.011796850711107254,
      "pose_rmse_dtheta": 0.054240234196186066,
      "pose_rmse_dx": 0.017027489840984344,
      "pose_rmse_dy": 0.03239502012729645,
      "pose_rmse_mean": 0.03455425053834915,
      "rmse_dtheta": 0.010316702537238598,
      "rmse_dx": 0.001941742724739015,
      "rmse_dy": 0.0014682210749015212,
      "rmse_mean": 0.004575555212795734,
      "rotation_flip": 0.0006680026999674737,
      "sparse_tokens": 32057.0,
      "step": 11454,
      "turn_loss": 0.030120613053441048,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5321966177290467,
      "grad_norm": 0.28873372077941895,
      "learning_rate": 5.202804821750951e-08,
      "loss": 0.0743,
      "mae_dtheta": 0.008545543998479843,
      "mae_dx": 0.0008910305332392454,
      "mae_dy": 0.0014328309334814548,
      "pose_mae_dtheta": 0.05753115564584732,
      "pose_mae_dx": 0.011050136759877205,
      "pose_mae_dy": 0.020045099779963493,
      "pose_rmse_dtheta": 0.1759810745716095,
      "pose_rmse_dx": 0.026826219633221626,
      "pose_rmse_dy": 0.06358598917722702,
      "pose_rmse_mean": 0.08879776298999786,
      "rmse_dtheta": 0.021015476435422897,
      "rmse_dx": 0.0028167227283120155,
      "rmse_dy": 0.0031139866914600134,
      "rmse_mean": 0.008982062339782715,
      "rotation_flip": 0.006415740121155977,
      "sparse_tokens": 32073.0,
      "step": 11455,
      "turn_loss": 0.05442657694220543,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5322430774948894,
      "grad_norm": 0.4748757779598236,
      "learning_rate": 5.183797350058251e-08,
      "loss": 0.111,
      "mae_dtheta": 0.007932494394481182,
      "mae_dx": 0.0014249373925849795,
      "mae_dy": 0.0015420678537338972,
      "pose_mae_dtheta": 0.04829537123441696,
      "pose_mae_dx": 0.014309359714388847,
      "pose_mae_dy": 0.020009024068713188,
      "pose_rmse_dtheta": 0.11216001957654953,
      "pose_rmse_dx": 0.03438626602292061,
      "pose_rmse_dy": 0.04849526286125183,
      "pose_rmse_mean": 0.06501385569572449,
      "rmse_dtheta": 0.017718540504574776,
      "rmse_dx": 0.004656418692320585,
      "rmse_dy": 0.003624256467446685,
      "rmse_mean": 0.008666405454277992,
      "rotation_flip": 0.010258514434099197,
      "sparse_tokens": 32137.0,
      "step": 11456,
      "turn_loss": 0.0688306987285614,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.5322895372607322,
      "grad_norm": 0.5782889723777771,
      "learning_rate": 5.1648244811282054e-08,
      "loss": 0.1588,
      "mae_dtheta": 0.031948573887348175,
      "mae_dx": 0.011372692883014679,
      "mae_dy": 0.005200208630412817,
      "pose_mae_dtheta": 0.238717719912529,
      "pose_mae_dx": 0.08482886850833893,
      "pose_mae_dy": 0.049280889332294464,
      "pose_rmse_dtheta": 0.42095983028411865,
      "pose_rmse_dx": 0.19399137794971466,
      "pose_rmse_dy": 0.12856806814670563,
      "pose_rmse_mean": 0.24783974885940552,
      "rmse_dtheta": 0.05157475918531418,
      "rmse_dx": 0.023467278108000755,
      "rmse_dy": 0.011746992357075214,
      "rmse_mean": 0.028929678723216057,
      "rotation_flip": 0.009416195563971996,
      "sparse_tokens": 8159.0,
      "step": 11457,
      "turn_loss": 0.2706761956214905,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.532335997026575,
      "grad_norm": 0.38217154145240784,
      "learning_rate": 5.1458862162875324e-08,
      "loss": 0.0727,
      "mae_dtheta": 0.009934117086231709,
      "mae_dx": 0.001673661288805306,
      "mae_dy": 0.001766937435604632,
      "pose_mae_dtheta": 0.06626545637845993,
      "pose_mae_dx": 0.018528221175074577,
      "pose_mae_dy": 0.019084885716438293,
      "pose_rmse_dtheta": 0.20024700462818146,
      "pose_rmse_dx": 0.053233422338962555,
      "pose_rmse_dy": 0.04170837998390198,
      "pose_rmse_mean": 0.09839627146720886,
      "rmse_dtheta": 0.025165436789393425,
      "rmse_dx": 0.005774940364062786,
      "rmse_dy": 0.003609313629567623,
      "rmse_mean": 0.011516563594341278,
      "rotation_flip": 0.002347417874261737,
      "sparse_tokens": 32105.0,
      "step": 11458,
      "turn_loss": 0.06370007991790771,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5323824567924178,
      "grad_norm": 0.4446484446525574,
      "learning_rate": 5.1269825568606715e-08,
      "loss": 0.0852,
      "mae_dtheta": 0.010917272418737411,
      "mae_dx": 0.0016457954188808799,
      "mae_dy": 0.0036947736516594887,
      "pose_mae_dtheta": 0.07260270416736603,
      "pose_mae_dx": 0.026035595685243607,
      "pose_mae_dy": 0.03709946200251579,
      "pose_rmse_dtheta": 0.16955433785915375,
      "pose_rmse_dx": 0.06295827031135559,
      "pose_rmse_dy": 0.09661222249269485,
      "pose_rmse_mean": 0.1097082793712616,
      "rmse_dtheta": 0.022271567955613136,
      "rmse_dx": 0.00409797253087163,
      "rmse_dy": 0.00859661865979433,
      "rmse_mean": 0.011655386537313461,
      "rotation_flip": 0.0030612244736403227,
      "sparse_tokens": 32073.0,
      "step": 11459,
      "turn_loss": 0.10133414715528488,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5324289165582605,
      "grad_norm": 0.37222355604171753,
      "learning_rate": 5.108113504169565e-08,
      "loss": 0.1002,
      "mae_dtheta": 0.0072964876890182495,
      "mae_dx": 0.0012082222383469343,
      "mae_dy": 0.0015993043780326843,
      "pose_mae_dtheta": 0.04062249884009361,
      "pose_mae_dx": 0.014910425059497356,
      "pose_mae_dy": 0.01624862663447857,
      "pose_rmse_dtheta": 0.0851902887225151,
      "pose_rmse_dx": 0.035558171570301056,
      "pose_rmse_dy": 0.0383974127471447,
      "pose_rmse_mean": 0.05304862558841705,
      "rmse_dtheta": 0.01642153039574623,
      "rmse_dx": 0.0035759606398642063,
      "rmse_dy": 0.003693213453516364,
      "rmse_mean": 0.007896902039647102,
      "rotation_flip": 0.005037783179432154,
      "sparse_tokens": 32105.0,
      "step": 11460,
      "turn_loss": 0.06581474840641022,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5324753763241034,
      "grad_norm": 0.3428725600242615,
      "learning_rate": 5.089279059533658e-08,
      "loss": 0.0784,
      "mae_dtheta": 0.006890953052788973,
      "mae_dx": 0.0012621391797438264,
      "mae_dy": 0.0018405684968456626,
      "pose_mae_dtheta": 0.04669325798749924,
      "pose_mae_dx": 0.01550202164798975,
      "pose_mae_dy": 0.021691178902983665,
      "pose_rmse_dtheta": 0.09838990867137909,
      "pose_rmse_dx": 0.04246247559785843,
      "pose_rmse_dy": 0.04941823333501816,
      "pose_rmse_mean": 0.06342354416847229,
      "rmse_dtheta": 0.014056260697543621,
      "rmse_dx": 0.004604404326528311,
      "rmse_dy": 0.004480941686779261,
      "rmse_mean": 0.007713868748396635,
      "rotation_flip": 0.004212945234030485,
      "sparse_tokens": 32105.0,
      "step": 11461,
      "turn_loss": 0.054938141256570816,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.5325218360899461,
      "grad_norm": 0.4415324926376343,
      "learning_rate": 5.0704792242701194e-08,
      "loss": 0.0901,
      "mae_dtheta": 0.029109137132763863,
      "mae_dx": 0.009181497618556023,
      "mae_dy": 0.005964432377368212,
      "pose_mae_dtheta": 0.22051101922988892,
      "pose_mae_dx": 0.08151974529027939,
      "pose_mae_dy": 0.07780583202838898,
      "pose_rmse_dtheta": 0.3963165283203125,
      "pose_rmse_dx": 0.1818803995847702,
      "pose_rmse_dy": 0.16835884749889374,
      "pose_rmse_mean": 0.24885194003582,
      "rmse_dtheta": 0.04760837182402611,
      "rmse_dx": 0.02049172855913639,
      "rmse_dy": 0.010626710020005703,
      "rmse_mean": 0.026242271065711975,
      "rotation_flip": 0.01759999990463257,
      "sparse_tokens": 12751.0,
      "step": 11462,
      "turn_loss": 0.23832623660564423,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.5325682958557889,
      "grad_norm": 0.5029944181442261,
      "learning_rate": 5.0517139996936196e-08,
      "loss": 0.1541,
      "mae_dtheta": 0.037587154656648636,
      "mae_dx": 0.011472497135400772,
      "mae_dy": 0.006349851842969656,
      "pose_mae_dtheta": 0.30057862401008606,
      "pose_mae_dx": 0.09296084195375443,
      "pose_mae_dy": 0.0877416729927063,
      "pose_rmse_dtheta": 0.482271283864975,
      "pose_rmse_dx": 0.20492392778396606,
      "pose_rmse_dy": 0.2136058360338211,
      "pose_rmse_mean": 0.3002670109272003,
      "rmse_dtheta": 0.05472793057560921,
      "rmse_dx": 0.023852171376347542,
      "rmse_dy": 0.01245705597102642,
      "rmse_mean": 0.030345721170306206,
      "rotation_flip": 0.01989389955997467,
      "sparse_tokens": 12609.0,
      "step": 11463,
      "turn_loss": 0.2837396264076233,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.5326147556216316,
      "grad_norm": 0.6699320077896118,
      "learning_rate": 5.0329833871163855e-08,
      "loss": 0.1621,
      "mae_dtheta": 0.034042030572891235,
      "mae_dx": 0.013657273724675179,
      "mae_dy": 0.005036052782088518,
      "pose_mae_dtheta": 0.28110677003860474,
      "pose_mae_dx": 0.10833698511123657,
      "pose_mae_dy": 0.04803834483027458,
      "pose_rmse_dtheta": 0.5049464106559753,
      "pose_rmse_dx": 0.2307606041431427,
      "pose_rmse_dy": 0.11322476714849472,
      "pose_rmse_mean": 0.28297728300094604,
      "rmse_dtheta": 0.05334867537021637,
      "rmse_dx": 0.026130711659789085,
      "rmse_dy": 0.01158352941274643,
      "rmse_mean": 0.03035430610179901,
      "rotation_flip": 0.015069968067109585,
      "sparse_tokens": 16999.0,
      "step": 11464,
      "turn_loss": 0.25278252363204956,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5326612153874745,
      "grad_norm": 0.4554094970226288,
      "learning_rate": 5.014287387848316e-08,
      "loss": 0.1049,
      "mae_dtheta": 0.011869048699736595,
      "mae_dx": 0.00203514751046896,
      "mae_dy": 0.002881038933992386,
      "pose_mae_dtheta": 0.07870019227266312,
      "pose_mae_dx": 0.02185249701142311,
      "pose_mae_dy": 0.024837277829647064,
      "pose_rmse_dtheta": 0.2077808976173401,
      "pose_rmse_dx": 0.06258530169725418,
      "pose_rmse_dy": 0.06529831141233444,
      "pose_rmse_mean": 0.11188817024230957,
      "rmse_dtheta": 0.025911463424563408,
      "rmse_dx": 0.005871093366295099,
      "rmse_dy": 0.00805761106312275,
      "rmse_mean": 0.013280056416988373,
      "rotation_flip": 0.0060412222519516945,
      "sparse_tokens": 32153.0,
      "step": 11465,
      "turn_loss": 0.11187036335468292,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5327076751533172,
      "grad_norm": 0.4306676387786865,
      "learning_rate": 4.995626003196807e-08,
      "loss": 0.0886,
      "mae_dtheta": 0.006680516991764307,
      "mae_dx": 0.0012769883032888174,
      "mae_dy": 0.0014771060086786747,
      "pose_mae_dtheta": 0.045795321464538574,
      "pose_mae_dx": 0.015434730798006058,
      "pose_mae_dy": 0.01940254494547844,
      "pose_rmse_dtheta": 0.10483937710523605,
      "pose_rmse_dx": 0.039601799100637436,
      "pose_rmse_dy": 0.048449043184518814,
      "pose_rmse_mean": 0.06429673731327057,
      "rmse_dtheta": 0.015316732227802277,
      "rmse_dx": 0.004229269456118345,
      "rmse_dy": 0.003323402488604188,
      "rmse_mean": 0.007623135112226009,
      "rotation_flip": 0.0038940811064094305,
      "sparse_tokens": 32153.0,
      "step": 11466,
      "turn_loss": 0.05227826163172722,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29522.0,
      "epoch": 0.53275413491916,
      "grad_norm": 0.4456271827220917,
      "learning_rate": 4.9769992344668174e-08,
      "loss": 0.1099,
      "mae_dtheta": 0.028227034956216812,
      "mae_dx": 0.010181628167629242,
      "mae_dy": 0.0032758344896137714,
      "pose_mae_dtheta": 0.2176344096660614,
      "pose_mae_dx": 0.0694449171423912,
      "pose_mae_dy": 0.02990647405385971,
      "pose_rmse_dtheta": 0.4224962890148163,
      "pose_rmse_dx": 0.17570118606090546,
      "pose_rmse_dy": 0.0727151408791542,
      "pose_rmse_mean": 0.22363755106925964,
      "rmse_dtheta": 0.048381540924310684,
      "rmse_dx": 0.022374650463461876,
      "rmse_dy": 0.008048685267567635,
      "rmse_mean": 0.02626829221844673,
      "rotation_flip": 0.012017167173326015,
      "sparse_tokens": 24703.0,
      "step": 11467,
      "turn_loss": 0.20870129764080048,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.5328005946850027,
      "grad_norm": 0.7823684215545654,
      "learning_rate": 4.958407082961025e-08,
      "loss": 0.1459,
      "mae_dtheta": 0.03782474622130394,
      "mae_dx": 0.012915304861962795,
      "mae_dy": 0.0051218485459685326,
      "pose_mae_dtheta": 0.31752809882164,
      "pose_mae_dx": 0.11373934894800186,
      "pose_mae_dy": 0.0559290312230587,
      "pose_rmse_dtheta": 0.5451655387878418,
      "pose_rmse_dx": 0.23128102719783783,
      "pose_rmse_dy": 0.12767648696899414,
      "pose_rmse_mean": 0.3013743758201599,
      "rmse_dtheta": 0.055772993713617325,
      "rmse_dx": 0.024135859683156013,
      "rmse_dy": 0.010666346177458763,
      "rmse_mean": 0.030191734433174133,
      "rotation_flip": 0.011737089604139328,
      "sparse_tokens": 14779.0,
      "step": 11468,
      "turn_loss": 0.2475786954164505,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.5328470544508456,
      "grad_norm": 0.5035092830657959,
      "learning_rate": 4.939849549979503e-08,
      "loss": 0.1104,
      "mae_dtheta": 0.021746762096881866,
      "mae_dx": 0.005531007423996925,
      "mae_dy": 0.002952390117570758,
      "pose_mae_dtheta": 0.1657794862985611,
      "pose_mae_dx": 0.03768966719508171,
      "pose_mae_dy": 0.03807434067130089,
      "pose_rmse_dtheta": 0.3550150394439697,
      "pose_rmse_dx": 0.10026203095912933,
      "pose_rmse_dy": 0.08348434418439865,
      "pose_rmse_mean": 0.17958715558052063,
      "rmse_dtheta": 0.03969935327768326,
      "rmse_dx": 0.01511107012629509,
      "rmse_dy": 0.005291681736707687,
      "rmse_mean": 0.02003403566777706,
      "rotation_flip": 0.010917030274868011,
      "sparse_tokens": 9840.0,
      "step": 11469,
      "turn_loss": 0.15123754739761353,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 8786.0,
      "epoch": 0.5328935142166884,
      "grad_norm": 1.1205329895019531,
      "learning_rate": 4.92132663681999e-08,
      "loss": 0.2966,
      "mae_dtheta": 0.03686867281794548,
      "mae_dx": 0.009466162882745266,
      "mae_dy": 0.005761683918535709,
      "pose_mae_dtheta": 0.2864353358745575,
      "pose_mae_dx": 0.06175032630562782,
      "pose_mae_dy": 0.07181078940629959,
      "pose_rmse_dtheta": 0.47716042399406433,
      "pose_rmse_dx": 0.13909803330898285,
      "pose_rmse_dy": 0.15922755002975464,
      "pose_rmse_mean": 0.2584953308105469,
      "rmse_dtheta": 0.05287424102425575,
      "rmse_dx": 0.020722001791000366,
      "rmse_dy": 0.010426284745335579,
      "rmse_mean": 0.02800750732421875,
      "rotation_flip": 0.013729977421462536,
      "sparse_tokens": 7050.0,
      "step": 11470,
      "turn_loss": 0.290847510099411,
      "turns": 27.0,
      "turns_per_sample": 27.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.5329399739825311,
      "grad_norm": 0.6609486937522888,
      "learning_rate": 4.902838344777894e-08,
      "loss": 0.1166,
      "mae_dtheta": 0.02887471206486225,
      "mae_dx": 0.007325572893023491,
      "mae_dy": 0.004475580994039774,
      "pose_mae_dtheta": 0.19991953670978546,
      "pose_mae_dx": 0.052563682198524475,
      "pose_mae_dy": 0.07425282895565033,
      "pose_rmse_dtheta": 0.36745479702949524,
      "pose_rmse_dx": 0.12566916644573212,
      "pose_rmse_dy": 0.18296493589878082,
      "pose_rmse_mean": 0.22536295652389526,
      "rmse_dtheta": 0.04626882076263428,
      "rmse_dx": 0.018952423706650734,
      "rmse_dy": 0.00842275470495224,
      "rmse_mean": 0.02454799972474575,
      "rotation_flip": 0.009652509354054928,
      "sparse_tokens": 8876.0,
      "step": 11471,
      "turn_loss": 0.18974393606185913,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.532986433748374,
      "grad_norm": 0.46623116731643677,
      "learning_rate": 4.884384675146014e-08,
      "loss": 0.14,
      "mae_dtheta": 0.038324419409036636,
      "mae_dx": 0.015390194021165371,
      "mae_dy": 0.005364499054849148,
      "pose_mae_dtheta": 0.29558297991752625,
      "pose_mae_dx": 0.12322556972503662,
      "pose_mae_dy": 0.051221609115600586,
      "pose_rmse_dtheta": 0.5308401584625244,
      "pose_rmse_dx": 0.25277289748191833,
      "pose_rmse_dy": 0.1349923014640808,
      "pose_rmse_mean": 0.3062018156051636,
      "rmse_dtheta": 0.057579223066568375,
      "rmse_dx": 0.02829427644610405,
      "rmse_dy": 0.013091882690787315,
      "rmse_mean": 0.03298846259713173,
      "rotation_flip": 0.0078125,
      "sparse_tokens": 20728.0,
      "step": 11472,
      "turn_loss": 0.3123885691165924,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5330328935142167,
      "grad_norm": 0.43152424693107605,
      "learning_rate": 4.865965629214819e-08,
      "loss": 0.1102,
      "mae_dtheta": 0.009017836302518845,
      "mae_dx": 0.0011591070797294378,
      "mae_dy": 0.0014805736718699336,
      "pose_mae_dtheta": 0.05882452055811882,
      "pose_mae_dx": 0.015423406846821308,
      "pose_mae_dy": 0.022092191502451897,
      "pose_rmse_dtheta": 0.15036781132221222,
      "pose_rmse_dx": 0.039347268640995026,
      "pose_rmse_dy": 0.049157049506902695,
      "pose_rmse_mean": 0.07962404936552048,
      "rmse_dtheta": 0.021614737808704376,
      "rmse_dx": 0.003643818199634552,
      "rmse_dy": 0.0029028099961578846,
      "rmse_mean": 0.009387122467160225,
      "rotation_flip": 0.0028865979984402657,
      "sparse_tokens": 32105.0,
      "step": 11473,
      "turn_loss": 0.06159033998847008,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5330793532800595,
      "grad_norm": 0.4348740875720978,
      "learning_rate": 4.8475812082725006e-08,
      "loss": 0.0836,
      "mae_dtheta": 0.009993793442845345,
      "mae_dx": 0.0017073622439056635,
      "mae_dy": 0.002486639888957143,
      "pose_mae_dtheta": 0.06303127855062485,
      "pose_mae_dx": 0.01826874166727066,
      "pose_mae_dy": 0.025082560256123543,
      "pose_rmse_dtheta": 0.1532471626996994,
      "pose_rmse_dx": 0.04639604687690735,
      "pose_rmse_dy": 0.05176661163568497,
      "pose_rmse_mean": 0.08380328118801117,
      "rmse_dtheta": 0.021512750536203384,
      "rmse_dx": 0.006785545032471418,
      "rmse_dy": 0.0056510730646550655,
      "rmse_mean": 0.011316455900669098,
      "rotation_flip": 0.005008944775909185,
      "sparse_tokens": 32105.0,
      "step": 11474,
      "turn_loss": 0.08145835250616074,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.5331258130459022,
      "grad_norm": 0.5883869528770447,
      "learning_rate": 4.8292314136044735e-08,
      "loss": 0.1506,
      "mae_dtheta": 0.031264662742614746,
      "mae_dx": 0.009300434030592442,
      "mae_dy": 0.004239281639456749,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5883868336677551,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 165.0794677734375,
      "model/head/act_norm_mean": 109.6791759672619,
      "model/head/act_norm_min": 72.98733520507812,
      "model/head/act_over_embed": 75.3725565573258,
      "model/head/grad_frac": 0.12944011390209198,
      "model/head/grad_norm": 0.07616086304187775,
      "model/head/grad_zero_frac": 0.00015895316028036177,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6991412450396826,
      "model/head/update_ratio": 0.001296468311920762,
      "model/head/weight_delta": 9.985503196716309,
      "model/head/weight_delta_rel": 0.17517530918121338,
      "model/head/weight_norm": 58.744869232177734,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228695034980774,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228695034980774,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228695034980774,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905998817705451,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08893875777721405,
      "model/modality_embedder.encoders.pose/grad_norm": 0.052330393344163895,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001689719851128757,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156804084777832,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1031426265835762,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969863891601562,
      "model/modality_embedder/grad_frac": 0.08893875777721405,
      "model/modality_embedder/grad_norm": 0.052330393344163895,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.001689719851128757,
      "model/modality_embedder/weight_delta": 3.156804084777832,
      "model/modality_embedder/weight_delta_rel": 0.1031426265835762,
      "model/modality_embedder/weight_norm": 30.969863891601562,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.26543426513672,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.543601584152178,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.062399864196777,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.17938342730016,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0971195250749588,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05714384838938713,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002043683547526598,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7425782680511475,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0999412089586258,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961200714111328,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 81.95159149169922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.32543816137566,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.536547660827637,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.716668842837496,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09358193725347519,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05506237968802452,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018495389958843589,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.477233409881592,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1204540804028511,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77086639404297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 83.49815368652344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.91939877802973,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.689102172851562,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.81205350149658,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09182325750589371,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.05402759462594986,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001757427933625877,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7671806812286377,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1264948695898056,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.74242401123047,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 83.65811920166016,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.72424571680524,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.632790565490723,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.052361215066373,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08096595108509064,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04763929918408394,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0015903257299214602,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2382750511169434,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11066887527704239,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955686569213867,
      "model/normalizer/grad_frac": 0.34738102555274963,
      "model/normalizer/grad_norm": 0.20439442992210388,
      "model/normalizer/grad_zero_frac": 0.00021389465837273747,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0025985196698457003,
      "model/normalizer/weight_delta": 6.80998420715332,
      "model/normalizer/weight_delta_rel": 0.08770865201950073,
      "model/normalizer/weight_norm": 78.65802764892578,
      "pose_mae_dtheta": 0.23149314522743225,
      "pose_mae_dx": 0.0791667103767395,
      "pose_mae_dy": 0.06900686025619507,
      "pose_rmse_dtheta": 0.4427700638771057,
      "pose_rmse_dx": 0.21630653738975525,
      "pose_rmse_dy": 0.16012312471866608,
      "pose_rmse_mean": 0.27306658029556274,
      "rmse_dtheta": 0.04940470680594444,
      "rmse_dx": 0.022653162479400635,
      "rmse_dy": 0.008253085426986217,
      "rmse_mean": 0.026770319789648056,
      "rotation_flip": 0.00800000037997961,
      "sparse_tokens": 15991.0,
      "step": 11475,
      "turn_loss": 0.2379370629787445,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 4560.0,
      "epoch": 0.5331722728117451,
      "grad_norm": 0.5380634665489197,
      "learning_rate": 4.810916246494157e-08,
      "loss": 0.1398,
      "mae_dtheta": 0.03540567308664322,
      "mae_dx": 0.012836170382797718,
      "mae_dy": 0.010396081954240799,
      "pose_mae_dtheta": 0.2749832570552826,
      "pose_mae_dx": 0.09475266933441162,
      "pose_mae_dy": 0.10343148559331894,
      "pose_rmse_dtheta": 0.47710099816322327,
      "pose_rmse_dx": 0.1851981282234192,
      "pose_rmse_dy": 0.29921481013298035,
      "pose_rmse_mean": 0.32050466537475586,
      "rmse_dtheta": 0.05520923063158989,
      "rmse_dx": 0.02258898690342903,
      "rmse_dy": 0.022097939625382423,
      "rmse_mean": 0.03329871967434883,
      "rotation_flip": 0.017467249184846878,
      "sparse_tokens": 3996.0,
      "step": 11476,
      "turn_loss": 0.3488340377807617,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 11669.0,
      "epoch": 0.5332187325775878,
      "grad_norm": 0.39680325984954834,
      "learning_rate": 4.792635708222249e-08,
      "loss": 0.0871,
      "mae_dtheta": 0.03786380589008331,
      "mae_dx": 0.012459862045943737,
      "mae_dy": 0.003987329546362162,
      "pose_mae_dtheta": 0.29734277725219727,
      "pose_mae_dx": 0.09343306720256805,
      "pose_mae_dy": 0.05750785395503044,
      "pose_rmse_dtheta": 0.5258054137229919,
      "pose_rmse_dx": 0.1955367922782898,
      "pose_rmse_dy": 0.12819261848926544,
      "pose_rmse_mean": 0.28317826986312866,
      "rmse_dtheta": 0.05636029317975044,
      "rmse_dx": 0.02469969354569912,
      "rmse_dy": 0.00784123595803976,
      "rmse_mean": 0.029633741825819016,
      "rotation_flip": 0.005424954928457737,
      "sparse_tokens": 10193.0,
      "step": 11477,
      "turn_loss": 0.2172372043132782,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 4563.0,
      "epoch": 0.5332651923434306,
      "grad_norm": 0.535453736782074,
      "learning_rate": 4.774389800067114e-08,
      "loss": 0.0884,
      "mae_dtheta": 0.028357377275824547,
      "mae_dx": 0.01187492348253727,
      "mae_dy": 0.0042906831949949265,
      "pose_mae_dtheta": 0.24033091962337494,
      "pose_mae_dx": 0.11409119516611099,
      "pose_mae_dy": 0.03977333754301071,
      "pose_rmse_dtheta": 0.4166414737701416,
      "pose_rmse_dx": 0.2241775244474411,
      "pose_rmse_dy": 0.09708409756422043,
      "pose_rmse_mean": 0.24596771597862244,
      "rmse_dtheta": 0.04447571188211441,
      "rmse_dx": 0.022223791107535362,
      "rmse_dy": 0.009554620832204819,
      "rmse_mean": 0.02541804313659668,
      "rotation_flip": 0.023255813866853714,
      "sparse_tokens": 3552.0,
      "step": 11478,
      "turn_loss": 0.2436765879392624,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5333116521092733,
      "grad_norm": 0.5272412896156311,
      "learning_rate": 4.756178523304622e-08,
      "loss": 0.0959,
      "mae_dtheta": 0.007587912026792765,
      "mae_dx": 0.0017474975902587175,
      "mae_dy": 0.0024428609758615494,
      "pose_mae_dtheta": 0.056248970329761505,
      "pose_mae_dx": 0.025945128872990608,
      "pose_mae_dy": 0.02694600634276867,
      "pose_rmse_dtheta": 0.12616387009620667,
      "pose_rmse_dx": 0.08223266154527664,
      "pose_rmse_dy": 0.0610491968691349,
      "pose_rmse_mean": 0.08981524407863617,
      "rmse_dtheta": 0.017476147040724754,
      "rmse_dx": 0.005508942063897848,
      "rmse_dy": 0.006174799520522356,
      "rmse_mean": 0.009719963185489178,
      "rotation_flip": 0.0035413899458944798,
      "sparse_tokens": 32057.0,
      "step": 11479,
      "turn_loss": 0.07226680219173431,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5333581118751162,
      "grad_norm": 0.4514671862125397,
      "learning_rate": 4.738001879208476e-08,
      "loss": 0.0913,
      "mae_dtheta": 0.012739725410938263,
      "mae_dx": 0.003375857835635543,
      "mae_dy": 0.004640770610421896,
      "pose_mae_dtheta": 0.0865180492401123,
      "pose_mae_dx": 0.0339026041328907,
      "pose_mae_dy": 0.03917495161294937,
      "pose_rmse_dtheta": 0.18464350700378418,
      "pose_rmse_dx": 0.09189655631780624,
      "pose_rmse_dy": 0.09884031862020493,
      "pose_rmse_mean": 0.12512680888175964,
      "rmse_dtheta": 0.026438618078827858,
      "rmse_dx": 0.010023927316069603,
      "rmse_dy": 0.011178235523402691,
      "rmse_mean": 0.01588026061654091,
      "rotation_flip": 0.005847953259944916,
      "sparse_tokens": 32121.0,
      "step": 11480,
      "turn_loss": 0.153769850730896,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5334045716409589,
      "grad_norm": 0.3766328990459442,
      "learning_rate": 4.719859869049659e-08,
      "loss": 0.0682,
      "mae_dtheta": 0.006594154518097639,
      "mae_dx": 0.0007534605683758855,
      "mae_dy": 0.0009375049849040806,
      "pose_mae_dtheta": 0.044039350003004074,
      "pose_mae_dx": 0.009312215261161327,
      "pose_mae_dy": 0.013918858021497726,
      "pose_rmse_dtheta": 0.15551775693893433,
      "pose_rmse_dx": 0.02347562648355961,
      "pose_rmse_dy": 0.03724409267306328,
      "pose_rmse_mean": 0.07207916676998138,
      "rmse_dtheta": 0.0198782067745924,
      "rmse_dx": 0.002538018161430955,
      "rmse_dy": 0.0021044895984232426,
      "rmse_mean": 0.008173571899533272,
      "rotation_flip": 0.0023752970155328512,
      "sparse_tokens": 32105.0,
      "step": 11481,
      "turn_loss": 0.04088824614882469,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5334510314068017,
      "grad_norm": 0.3797633647918701,
      "learning_rate": 4.701752494096823e-08,
      "loss": 0.0911,
      "mae_dtheta": 0.012691984884440899,
      "mae_dx": 0.0015960985329002142,
      "mae_dy": 0.002392512047663331,
      "pose_mae_dtheta": 0.0825522318482399,
      "pose_mae_dx": 0.021683156490325928,
      "pose_mae_dy": 0.029112135991454124,
      "pose_rmse_dtheta": 0.21561039984226227,
      "pose_rmse_dx": 0.04813463240861893,
      "pose_rmse_dy": 0.060601856559515,
      "pose_rmse_mean": 0.10811563581228256,
      "rmse_dtheta": 0.026222096756100655,
      "rmse_dx": 0.004401321057230234,
      "rmse_dy": 0.004943538922816515,
      "rmse_mean": 0.011855652555823326,
      "rotation_flip": 0.0048971595242619514,
      "sparse_tokens": 32137.0,
      "step": 11482,
      "turn_loss": 0.09208536893129349,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5334974911726444,
      "grad_norm": 0.3909945487976074,
      "learning_rate": 4.683679755616344e-08,
      "loss": 0.1092,
      "mae_dtheta": 0.00658530043438077,
      "mae_dx": 0.001780943712219596,
      "mae_dy": 0.001144956680946052,
      "pose_mae_dtheta": 0.047277968376874924,
      "pose_mae_dx": 0.01460888609290123,
      "pose_mae_dy": 0.01548245269805193,
      "pose_rmse_dtheta": 0.11561331152915955,
      "pose_rmse_dx": 0.03637055307626724,
      "pose_rmse_dy": 0.03957704082131386,
      "pose_rmse_mean": 0.06385363638401031,
      "rmse_dtheta": 0.016526738181710243,
      "rmse_dx": 0.005509912967681885,
      "rmse_dy": 0.0027514034882187843,
      "rmse_mean": 0.008262685500085354,
      "rotation_flip": 0.0025510203558951616,
      "sparse_tokens": 32105.0,
      "step": 11483,
      "turn_loss": 0.0637490376830101,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5335439509384873,
      "grad_norm": 1.002730131149292,
      "learning_rate": 4.6656416548719886e-08,
      "loss": 0.1678,
      "mae_dtheta": 0.009504327550530434,
      "mae_dx": 0.002041333122178912,
      "mae_dy": 0.0026355383452028036,
      "pose_mae_dtheta": 0.06666915863752365,
      "pose_mae_dx": 0.026302818208932877,
      "pose_mae_dy": 0.029185280203819275,
      "pose_rmse_dtheta": 0.17165125906467438,
      "pose_rmse_dx": 0.11267911642789841,
      "pose_rmse_dy": 0.08644693344831467,
      "pose_rmse_mean": 0.12359243631362915,
      "rmse_dtheta": 0.0222859475761652,
      "rmse_dx": 0.00786509457975626,
      "rmse_dy": 0.007972604595124722,
      "rmse_mean": 0.01270788349211216,
      "rotation_flip": 0.003000428667291999,
      "sparse_tokens": 32073.0,
      "step": 11484,
      "turn_loss": 0.08484045416116714,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.53359041070433,
      "grad_norm": 0.3694635331630707,
      "learning_rate": 4.6476381931251366e-08,
      "loss": 0.0676,
      "mae_dtheta": 0.006278411950916052,
      "mae_dx": 0.0015280797379091382,
      "mae_dy": 0.001526011386886239,
      "pose_mae_dtheta": 0.042598456144332886,
      "pose_mae_dx": 0.016570083796977997,
      "pose_mae_dy": 0.01772230491042137,
      "pose_rmse_dtheta": 0.08946534246206284,
      "pose_rmse_dx": 0.05831240490078926,
      "pose_rmse_dy": 0.04316142201423645,
      "pose_rmse_mean": 0.06364639103412628,
      "rmse_dtheta": 0.013368673622608185,
      "rmse_dx": 0.005965047515928745,
      "rmse_dy": 0.0035449217539280653,
      "rmse_mean": 0.007626214064657688,
      "rotation_flip": 0.00077851302921772,
      "sparse_tokens": 32153.0,
      "step": 11485,
      "turn_loss": 0.05164105445146561,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7816.0,
      "epoch": 0.5336368704701728,
      "grad_norm": 0.6040540933609009,
      "learning_rate": 4.6296693716348375e-08,
      "loss": 0.183,
      "mae_dtheta": 0.023248599842190742,
      "mae_dx": 0.010844346135854721,
      "mae_dy": 0.0032556578516960144,
      "pose_mae_dtheta": 0.183648481965065,
      "pose_mae_dx": 0.10074923932552338,
      "pose_mae_dy": 0.05476396158337593,
      "pose_rmse_dtheta": 0.33698534965515137,
      "pose_rmse_dx": 0.2502933442592621,
      "pose_rmse_dy": 0.10650569945573807,
      "pose_rmse_mean": 0.2312614768743515,
      "rmse_dtheta": 0.04038497805595398,
      "rmse_dx": 0.024380773305892944,
      "rmse_dy": 0.005237801931798458,
      "rmse_mean": 0.02333451807498932,
      "rotation_flip": 0.0026385225355625153,
      "sparse_tokens": 6714.0,
      "step": 11486,
      "turn_loss": 0.18944114446640015,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 25555.0,
      "epoch": 0.5336833302360157,
      "grad_norm": 0.47116437554359436,
      "learning_rate": 4.61173519165764e-08,
      "loss": 0.1244,
      "mae_dtheta": 0.034811265766620636,
      "mae_dx": 0.013090354390442371,
      "mae_dy": 0.008606551215052605,
      "pose_mae_dtheta": 0.2728216350078583,
      "pose_mae_dx": 0.0973137617111206,
      "pose_mae_dy": 0.10050524771213531,
      "pose_rmse_dtheta": 0.4433046281337738,
      "pose_rmse_dx": 0.20999698340892792,
      "pose_rmse_dy": 0.22278417646884918,
      "pose_rmse_mean": 0.29202860593795776,
      "rmse_dtheta": 0.049880072474479675,
      "rmse_dx": 0.02475355751812458,
      "rmse_dy": 0.017176002264022827,
      "rmse_mean": 0.030603211373090744,
      "rotation_flip": 0.018106995150446892,
      "sparse_tokens": 21496.0,
      "step": 11487,
      "turn_loss": 0.32336023449897766,
      "turns": 79.0,
      "turns_per_sample": 79.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5337297900018584,
      "grad_norm": 0.4530560374259949,
      "learning_rate": 4.593835654447709e-08,
      "loss": 0.0757,
      "mae_dtheta": 0.007769468706101179,
      "mae_dx": 0.0015686959959566593,
      "mae_dy": 0.0012521963799372315,
      "pose_mae_dtheta": 0.05559281259775162,
      "pose_mae_dx": 0.0162698682397604,
      "pose_mae_dy": 0.019662916660308838,
      "pose_rmse_dtheta": 0.14880362153053284,
      "pose_rmse_dx": 0.05524883791804314,
      "pose_rmse_dy": 0.048022590577602386,
      "pose_rmse_mean": 0.08402501791715622,
      "rmse_dtheta": 0.01885521225631237,
      "rmse_dx": 0.006644925102591515,
      "rmse_dy": 0.002566358307376504,
      "rmse_mean": 0.009355498477816582,
      "rotation_flip": 0.0030895983800292015,
      "sparse_tokens": 32057.0,
      "step": 11488,
      "turn_loss": 0.06127399206161499,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.5337762497677012,
      "grad_norm": 0.5883467197418213,
      "learning_rate": 4.575970761256765e-08,
      "loss": 0.1636,
      "mae_dtheta": 0.020735330879688263,
      "mae_dx": 0.007060607895255089,
      "mae_dy": 0.0029921173118054867,
      "pose_mae_dtheta": 0.16074301302433014,
      "pose_mae_dx": 0.03963764011859894,
      "pose_mae_dy": 0.03898629546165466,
      "pose_rmse_dtheta": 0.3391818702220917,
      "pose_rmse_dx": 0.0971338078379631,
      "pose_rmse_dy": 0.10674970597028732,
      "pose_rmse_mean": 0.1810217946767807,
      "rmse_dtheta": 0.03822049871087074,
      "rmse_dx": 0.01760416477918625,
      "rmse_dy": 0.0065654548816382885,
      "rmse_mean": 0.020796706900000572,
      "rotation_flip": 0.01315789483487606,
      "sparse_tokens": 10558.0,
      "step": 11489,
      "turn_loss": 0.14814740419387817,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 27493.0,
      "epoch": 0.5338227095335439,
      "grad_norm": 0.6910623908042908,
      "learning_rate": 4.558140513334031e-08,
      "loss": 0.1606,
      "mae_dtheta": 0.03045077621936798,
      "mae_dx": 0.010293044149875641,
      "mae_dy": 0.003372778417542577,
      "pose_mae_dtheta": 0.23920315504074097,
      "pose_mae_dx": 0.08320360630750656,
      "pose_mae_dy": 0.03858475387096405,
      "pose_rmse_dtheta": 0.4150136709213257,
      "pose_rmse_dx": 0.20180435478687286,
      "pose_rmse_dy": 0.08998731523752213,
      "pose_rmse_mean": 0.2356017827987671,
      "rmse_dtheta": 0.04798584058880806,
      "rmse_dx": 0.02197950705885887,
      "rmse_dy": 0.007069879677146673,
      "rmse_mean": 0.02567840926349163,
      "rotation_flip": 0.013788098469376564,
      "sparse_tokens": 21741.0,
      "step": 11490,
      "turn_loss": 0.24001920223236084,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5338691692993868,
      "grad_norm": 0.504436194896698,
      "learning_rate": 4.5403449119265085e-08,
      "loss": 0.1041,
      "mae_dtheta": 0.008126165717840195,
      "mae_dx": 0.0011898449156433344,
      "mae_dy": 0.0016116676852107048,
      "pose_mae_dtheta": 0.05497480183839798,
      "pose_mae_dx": 0.016098853200674057,
      "pose_mae_dy": 0.023216351866722107,
      "pose_rmse_dtheta": 0.12827624380588531,
      "pose_rmse_dx": 0.03951980173587799,
      "pose_rmse_dy": 0.05767107009887695,
      "pose_rmse_mean": 0.07515570521354675,
      "rmse_dtheta": 0.017609653994441032,
      "rmse_dx": 0.003989482764154673,
      "rmse_dy": 0.0032585901208221912,
      "rmse_mean": 0.008285908959805965,
      "rotation_flip": 0.0026385225355625153,
      "sparse_tokens": 32057.0,
      "step": 11491,
      "turn_loss": 0.05701487138867378,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5339156290652295,
      "grad_norm": 0.5086421370506287,
      "learning_rate": 4.522583958278593e-08,
      "loss": 0.1578,
      "mae_dtheta": 0.008414947427809238,
      "mae_dx": 0.0011587166227400303,
      "mae_dy": 0.0019351004157215357,
      "pose_mae_dtheta": 0.05104602873325348,
      "pose_mae_dx": 0.01363436784595251,
      "pose_mae_dy": 0.01993524841964245,
      "pose_rmse_dtheta": 0.11374414712190628,
      "pose_rmse_dx": 0.03153184801340103,
      "pose_rmse_dy": 0.042088981717824936,
      "pose_rmse_mean": 0.06245499476790428,
      "rmse_dtheta": 0.018107052892446518,
      "rmse_dx": 0.0031502486672252417,
      "rmse_dy": 0.00404102448374033,
      "rmse_mean": 0.008432775735855103,
      "rotation_flip": 0.003484320593997836,
      "sparse_tokens": 32137.0,
      "step": 11492,
      "turn_loss": 0.06184748560190201,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.5339620888310723,
      "grad_norm": 0.48497405648231506,
      "learning_rate": 4.5048576536322885e-08,
      "loss": 0.1253,
      "mae_dtheta": 0.03229537233710289,
      "mae_dx": 0.00864098034799099,
      "mae_dy": 0.0023790993727743626,
      "pose_mae_dtheta": 0.23972070217132568,
      "pose_mae_dx": 0.06811513006687164,
      "pose_mae_dy": 0.025690482929348946,
      "pose_rmse_dtheta": 0.4332943558692932,
      "pose_rmse_dx": 0.1605294644832611,
      "pose_rmse_dy": 0.06421947479248047,
      "pose_rmse_mean": 0.2193477600812912,
      "rmse_dtheta": 0.05104193463921547,
      "rmse_dx": 0.019645702093839645,
      "rmse_dy": 0.00507703423500061,
      "rmse_mean": 0.02525489032268524,
      "rotation_flip": 0.011615628376603127,
      "sparse_tokens": 16485.0,
      "step": 11493,
      "turn_loss": 0.21476036310195923,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.534008548596915,
      "grad_norm": 0.5899419188499451,
      "learning_rate": 4.487165999227272e-08,
      "loss": 0.1045,
      "mae_dtheta": 0.008844212628901005,
      "mae_dx": 0.002892391989007592,
      "mae_dy": 0.0015342968981713057,
      "pose_mae_dtheta": 0.06569573283195496,
      "pose_mae_dx": 0.02641979046165943,
      "pose_mae_dy": 0.020879540592432022,
      "pose_rmse_dtheta": 0.2123512327671051,
      "pose_rmse_dx": 0.11507680267095566,
      "pose_rmse_dy": 0.07298321276903152,
      "pose_rmse_mean": 0.13347041606903076,
      "rmse_dtheta": 0.025434324517846107,
      "rmse_dx": 0.011706458404660225,
      "rmse_dy": 0.005726282950490713,
      "rmse_mean": 0.014289021492004395,
      "rotation_flip": 0.003492433112114668,
      "sparse_tokens": 32105.0,
      "step": 11494,
      "turn_loss": 0.06604961305856705,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5340550083627579,
      "grad_norm": 0.5683519244194031,
      "learning_rate": 4.469508996300664e-08,
      "loss": 0.1927,
      "mae_dtheta": 0.009679335169494152,
      "mae_dx": 0.002028615679591894,
      "mae_dy": 0.002138840965926647,
      "pose_mae_dtheta": 0.06873340159654617,
      "pose_mae_dx": 0.0158361978828907,
      "pose_mae_dy": 0.015739114955067635,
      "pose_rmse_dtheta": 0.22029893100261688,
      "pose_rmse_dx": 0.052781861275434494,
      "pose_rmse_dy": 0.056162282824516296,
      "pose_rmse_mean": 0.10974769294261932,
      "rmse_dtheta": 0.028107261285185814,
      "rmse_dx": 0.006319872569292784,
      "rmse_dy": 0.008279912173748016,
      "rmse_mean": 0.014235681854188442,
      "rotation_flip": 0.004730928223580122,
      "sparse_tokens": 32121.0,
      "step": 11495,
      "turn_loss": 0.07648638635873795,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5341014681286006,
      "grad_norm": 0.3974185287952423,
      "learning_rate": 4.451886646087256e-08,
      "loss": 0.0993,
      "mae_dtheta": 0.006499332841485739,
      "mae_dx": 0.0009914960246533155,
      "mae_dy": 0.0008555500535294414,
      "pose_mae_dtheta": 0.0478527694940567,
      "pose_mae_dx": 0.010681604966521263,
      "pose_mae_dy": 0.01234856154769659,
      "pose_rmse_dtheta": 0.1783340871334076,
      "pose_rmse_dx": 0.027493998408317566,
      "pose_rmse_dy": 0.03199612349271774,
      "pose_rmse_mean": 0.0792747363448143,
      "rmse_dtheta": 0.02099917083978653,
      "rmse_dx": 0.0029924954287707806,
      "rmse_dy": 0.00208159233443439,
      "rmse_mean": 0.008691086433827877,
      "rotation_flip": 0.0019920319318771362,
      "sparse_tokens": 32121.0,
      "step": 11496,
      "turn_loss": 0.042148277163505554,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10082.0,
      "epoch": 0.5341479278944434,
      "grad_norm": 0.4989217519760132,
      "learning_rate": 4.434298949819449e-08,
      "loss": 0.1207,
      "mae_dtheta": 0.027964536100625992,
      "mae_dx": 0.009154089726507664,
      "mae_dy": 0.007179731037467718,
      "pose_mae_dtheta": 0.22531384229660034,
      "pose_mae_dx": 0.07867192476987839,
      "pose_mae_dy": 0.10418128967285156,
      "pose_rmse_dtheta": 0.39677149057388306,
      "pose_rmse_dx": 0.23361225426197052,
      "pose_rmse_dy": 0.2855551838874817,
      "pose_rmse_mean": 0.30531299114227295,
      "rmse_dtheta": 0.04322981834411621,
      "rmse_dx": 0.022896060720086098,
      "rmse_dy": 0.01582181453704834,
      "rmse_mean": 0.02731589786708355,
      "rotation_flip": 0.004524887073785067,
      "sparse_tokens": 8438.0,
      "step": 11497,
      "turn_loss": 0.23766212165355682,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 32763.0,
      "epoch": 0.5341943876602862,
      "grad_norm": 0.5998682975769043,
      "learning_rate": 4.416745908727038e-08,
      "loss": 0.192,
      "mae_dtheta": 0.033045463263988495,
      "mae_dx": 0.00966103095561266,
      "mae_dy": 0.00396820018067956,
      "pose_mae_dtheta": 0.2558286488056183,
      "pose_mae_dx": 0.07554305344820023,
      "pose_mae_dy": 0.04590340703725815,
      "pose_rmse_dtheta": 0.46105876564979553,
      "pose_rmse_dx": 0.1760258823633194,
      "pose_rmse_dy": 0.12977175414562225,
      "pose_rmse_mean": 0.2556188106536865,
      "rmse_dtheta": 0.05219537019729614,
      "rmse_dx": 0.020882463082671165,
      "rmse_dy": 0.008543630130589008,
      "rmse_mean": 0.027207156643271446,
      "rotation_flip": 0.01371742133051157,
      "sparse_tokens": 25362.0,
      "step": 11498,
      "turn_loss": 0.22061996161937714,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 35363.0,
      "epoch": 0.534240847426129,
      "grad_norm": 0.5497041940689087,
      "learning_rate": 4.399227524037597e-08,
      "loss": 0.1424,
      "mae_dtheta": 0.03373228758573532,
      "mae_dx": 0.011809845454990864,
      "mae_dy": 0.004485519137233496,
      "pose_mae_dtheta": 0.27524110674858093,
      "pose_mae_dx": 0.09539713710546494,
      "pose_mae_dy": 0.045450784265995026,
      "pose_rmse_dtheta": 0.5060532093048096,
      "pose_rmse_dx": 0.21795570850372314,
      "pose_rmse_dy": 0.11033742874860764,
      "pose_rmse_mean": 0.278115451335907,
      "rmse_dtheta": 0.05335729569196701,
      "rmse_dx": 0.02417873777449131,
      "rmse_dy": 0.008630096912384033,
      "rmse_mean": 0.028722044080495834,
      "rotation_flip": 0.013084111735224724,
      "sparse_tokens": 28422.0,
      "step": 11499,
      "turn_loss": 0.2477417141199112,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 62523.0,
      "epoch": 0.5342873071919717,
      "grad_norm": 0.5736003518104553,
      "learning_rate": 4.381743796976201e-08,
      "loss": 0.0992,
      "mae_dtheta": 0.014726860448718071,
      "mae_dx": 0.0018295187037438154,
      "mae_dy": 0.003961068112403154,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5736004114151001,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 149.0048828125,
      "model/head/act_norm_mean": 95.69640096028645,
      "model/head/act_norm_min": 54.891727447509766,
      "model/head/act_over_embed": 65.76346266373015,
      "model/head/grad_frac": 0.07678691297769547,
      "model/head/grad_norm": 0.04404500499367714,
      "model/head/grad_zero_frac": 0.00019131487351842225,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7127685546875,
      "model/head/update_ratio": 0.0007497674087062478,
      "model/head/weight_delta": 9.985591888427734,
      "model/head/weight_delta_rel": 0.17517685890197754,
      "model/head/weight_norm": 58.74489212036133,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229447543621063,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228659974577281,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227891266345978,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.290597472386793,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10104264318943024,
      "model/modality_embedder.encoders.pose/grad_norm": 0.057958103716373444,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5293794014084507,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0018714350881054997,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156885862350464,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1031453013420105,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969871520996094,
      "model/modality_embedder/grad_frac": 0.10104264318943024,
      "model/modality_embedder/grad_norm": 0.057958103716373444,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5293794014084507,
      "model/modality_embedder/update_ratio": 0.0018714350881054997,
      "model/modality_embedder/weight_delta": 3.156885862350464,
      "model/modality_embedder/weight_delta_rel": 0.1031453013420105,
      "model/modality_embedder/weight_norm": 30.969871520996094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.46531677246094,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.242642195767196,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.017633438110352,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.285351955828311,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.042375918477773666,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.024306844919919968,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008693058043718338,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7426254749298096,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09994293004274368,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961214065551758,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.98606872558594,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.166565910218253,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.303971290588379,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.920280982309174,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.04485585168004036,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.025729335844516754,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000363137514796108,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008642448810860515,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4773013591766357,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12045643478631973,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770885467529297,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.76668548583984,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 24.937629174933864,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.435307502746582,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.137372238777264,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.041612837463617325,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.023869140073657036,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007764227921143174,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.76725697517395,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12649743258953094,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742450714111328,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.48220825195312,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.745744977678573,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.261509895324707,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.379926346270274,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.039675626903772354,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02275795489549637,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007597199873998761,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.238351821899414,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1106714978814125,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95571517944336,
      "model/normalizer/grad_frac": 0.14696213603019714,
      "model/normalizer/grad_norm": 0.0842975378036499,
      "model/normalizer/grad_zero_frac": 0.0002930711198132485,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010716962860897183,
      "model/normalizer/weight_delta": 6.810122489929199,
      "model/normalizer/weight_delta_rel": 0.0877104327082634,
      "model/normalizer/weight_norm": 78.65805053710938,
      "pose_mae_dtheta": 0.09774199873209,
      "pose_mae_dx": 0.029553962871432304,
      "pose_mae_dy": 0.04346058890223503,
      "pose_rmse_dtheta": 0.20822975039482117,
      "pose_rmse_dx": 0.07126513123512268,
      "pose_rmse_dy": 0.10303971916437149,
      "pose_rmse_mean": 0.12751153111457825,
      "rmse_dtheta": 0.02765941433608532,
      "rmse_dx": 0.005035545211285353,
      "rmse_dy": 0.008078014478087425,
      "rmse_mean": 0.013590991497039795,
      "rotation_flip": 0.005723905749619007,
      "sparse_tokens": 31923.0,
      "step": 11500,
      "turn_loss": 0.12407013028860092,
      "turns": 192.0,
      "turns_per_sample": 192.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5343337669578145,
      "grad_norm": 0.4164326786994934,
      "learning_rate": 4.3642947287654284e-08,
      "loss": 0.0897,
      "mae_dtheta": 0.006837006192654371,
      "mae_dx": 0.001197919133119285,
      "mae_dy": 0.0015113430563360453,
      "pose_mae_dtheta": 0.04382474720478058,
      "pose_mae_dx": 0.014340506866574287,
      "pose_mae_dy": 0.01991821825504303,
      "pose_rmse_dtheta": 0.09679392725229263,
      "pose_rmse_dx": 0.03574615716934204,
      "pose_rmse_dy": 0.051068004220724106,
      "pose_rmse_mean": 0.061202697455883026,
      "rmse_dtheta": 0.014830152504146099,
      "rmse_dx": 0.003860178869217634,
      "rmse_dy": 0.003462346037849784,
      "rmse_mean": 0.0073842257261276245,
      "rotation_flip": 0.00809889193624258,
      "sparse_tokens": 32105.0,
      "step": 11501,
      "turn_loss": 0.06202545017004013,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5343802267236573,
      "grad_norm": 0.3743797838687897,
      "learning_rate": 4.346880320625635e-08,
      "loss": 0.085,
      "mae_dtheta": 0.00931231677532196,
      "mae_dx": 0.0029259987641125917,
      "mae_dy": 0.0017205963376909494,
      "pose_mae_dtheta": 0.055663563311100006,
      "pose_mae_dx": 0.027356747537851334,
      "pose_mae_dy": 0.02633553370833397,
      "pose_rmse_dtheta": 0.12260967493057251,
      "pose_rmse_dx": 0.07683253288269043,
      "pose_rmse_dy": 0.0700494721531868,
      "pose_rmse_mean": 0.08983056247234344,
      "rmse_dtheta": 0.01992640271782875,
      "rmse_dx": 0.00943655427545309,
      "rmse_dy": 0.00391771923750639,
      "rmse_mean": 0.011093559674918652,
      "rotation_flip": 0.006872852332890034,
      "sparse_tokens": 32105.0,
      "step": 11502,
      "turn_loss": 0.1118919849395752,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5344266864895001,
      "grad_norm": 0.3649464547634125,
      "learning_rate": 4.329500573774459e-08,
      "loss": 0.0985,
      "mae_dtheta": 0.009805535897612572,
      "mae_dx": 0.001821118756197393,
      "mae_dy": 0.002431666711345315,
      "pose_mae_dtheta": 0.07094184309244156,
      "pose_mae_dx": 0.024111084640026093,
      "pose_mae_dy": 0.026464536786079407,
      "pose_rmse_dtheta": 0.18010854721069336,
      "pose_rmse_dx": 0.08281179517507553,
      "pose_rmse_dy": 0.06234225630760193,
      "pose_rmse_mean": 0.10842087119817734,
      "rmse_dtheta": 0.022160440683364868,
      "rmse_dx": 0.005350480321794748,
      "rmse_dy": 0.005628513637930155,
      "rmse_mean": 0.011046478524804115,
      "rotation_flip": 0.009730207733809948,
      "sparse_tokens": 32105.0,
      "step": 11503,
      "turn_loss": 0.08782080560922623,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32114.0,
      "epoch": 0.5344731462553429,
      "grad_norm": 0.38870343565940857,
      "learning_rate": 4.312155489427372e-08,
      "loss": 0.1141,
      "mae_dtheta": 0.02230227366089821,
      "mae_dx": 0.008191271685063839,
      "mae_dy": 0.004820845555514097,
      "pose_mae_dtheta": 0.16464921832084656,
      "pose_mae_dx": 0.06379124522209167,
      "pose_mae_dy": 0.052649565041065216,
      "pose_rmse_dtheta": 0.2981383502483368,
      "pose_rmse_dx": 0.16134457290172577,
      "pose_rmse_dy": 0.1264529973268509,
      "pose_rmse_mean": 0.19531196355819702,
      "rmse_dtheta": 0.036175455898046494,
      "rmse_dx": 0.019229821860790253,
      "rmse_dy": 0.009642449207603931,
      "rmse_mean": 0.021682575345039368,
      "rotation_flip": 0.018105849623680115,
      "sparse_tokens": 25374.0,
      "step": 11504,
      "turn_loss": 0.19749870896339417,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5345196060211856,
      "grad_norm": 0.30522456765174866,
      "learning_rate": 4.294845068797349e-08,
      "loss": 0.0628,
      "mae_dtheta": 0.008143451064825058,
      "mae_dx": 0.0010082842782139778,
      "mae_dy": 0.001752090989612043,
      "pose_mae_dtheta": 0.054721198976039886,
      "pose_mae_dx": 0.013581778854131699,
      "pose_mae_dy": 0.02206346206367016,
      "pose_rmse_dtheta": 0.16776017844676971,
      "pose_rmse_dx": 0.03278662636876106,
      "pose_rmse_dy": 0.04807688668370247,
      "pose_rmse_mean": 0.08287456631660461,
      "rmse_dtheta": 0.01972608081996441,
      "rmse_dx": 0.0027806502766907215,
      "rmse_dy": 0.0035779017489403486,
      "rmse_mean": 0.008694877848029137,
      "rotation_flip": 0.003916960209608078,
      "sparse_tokens": 32089.0,
      "step": 11505,
      "turn_loss": 0.05964601784944534,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5345660657870285,
      "grad_norm": 0.4380320906639099,
      "learning_rate": 4.2775693130948094e-08,
      "loss": 0.0755,
      "mae_dtheta": 0.009798006154596806,
      "mae_dx": 0.0017199348658323288,
      "mae_dy": 0.0019892738200724125,
      "pose_mae_dtheta": 0.06629722565412521,
      "pose_mae_dx": 0.021868623793125153,
      "pose_mae_dy": 0.023910628631711006,
      "pose_rmse_dtheta": 0.17444105446338654,
      "pose_rmse_dx": 0.05730126053094864,
      "pose_rmse_dy": 0.05800146609544754,
      "pose_rmse_mean": 0.09658126533031464,
      "rmse_dtheta": 0.022403424605727196,
      "rmse_dx": 0.0052533564157783985,
      "rmse_dy": 0.004610751289874315,
      "rmse_mean": 0.010755844414234161,
      "rotation_flip": 0.0030594405252486467,
      "sparse_tokens": 32121.0,
      "step": 11506,
      "turn_loss": 0.07405064254999161,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.5346125255528712,
      "grad_norm": 0.4871050715446472,
      "learning_rate": 4.260328223527954e-08,
      "loss": 0.1552,
      "mae_dtheta": 0.022809144109487534,
      "mae_dx": 0.008309523575007915,
      "mae_dy": 0.006166732870042324,
      "pose_mae_dtheta": 0.14245939254760742,
      "pose_mae_dx": 0.07617784291505814,
      "pose_mae_dy": 0.07537119090557098,
      "pose_rmse_dtheta": 0.25449609756469727,
      "pose_rmse_dx": 0.20178218185901642,
      "pose_rmse_dy": 0.15778836607933044,
      "pose_rmse_mean": 0.2046888768672943,
      "rmse_dtheta": 0.03694713115692139,
      "rmse_dx": 0.020999470725655556,
      "rmse_dy": 0.01310646254569292,
      "rmse_mean": 0.02368435636162758,
      "rotation_flip": 0.01605839468538761,
      "sparse_tokens": 13590.0,
      "step": 11507,
      "turn_loss": 0.25306007266044617,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.534658985318714,
      "grad_norm": 0.5150494575500488,
      "learning_rate": 4.243121801302375e-08,
      "loss": 0.1403,
      "mae_dtheta": 0.00604108814150095,
      "mae_dx": 0.0010482564102858305,
      "mae_dy": 0.0015333729097619653,
      "pose_mae_dtheta": 0.035791654139757156,
      "pose_mae_dx": 0.013139179907739162,
      "pose_mae_dy": 0.01870880462229252,
      "pose_rmse_dtheta": 0.06849096715450287,
      "pose_rmse_dx": 0.029711883515119553,
      "pose_rmse_dy": 0.04261883348226547,
      "pose_rmse_mean": 0.04694056510925293,
      "rmse_dtheta": 0.012333857826888561,
      "rmse_dx": 0.0030934051610529423,
      "rmse_dy": 0.0031584887765347958,
      "rmse_mean": 0.006195250898599625,
      "rotation_flip": 0.0019470405532047153,
      "sparse_tokens": 32121.0,
      "step": 11508,
      "turn_loss": 0.04865263029932976,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.5347054450845568,
      "grad_norm": 0.4129006564617157,
      "learning_rate": 4.225950047621441e-08,
      "loss": 0.1012,
      "mae_dtheta": 0.023845568299293518,
      "mae_dx": 0.007759444415569305,
      "mae_dy": 0.004574453923851252,
      "pose_mae_dtheta": 0.17889270186424255,
      "pose_mae_dx": 0.066990427672863,
      "pose_mae_dy": 0.059690941125154495,
      "pose_rmse_dtheta": 0.3118859529495239,
      "pose_rmse_dx": 0.14067168533802032,
      "pose_rmse_dy": 0.14416003227233887,
      "pose_rmse_mean": 0.19890588521957397,
      "rmse_dtheta": 0.039357852190732956,
      "rmse_dx": 0.018133753910660744,
      "rmse_dy": 0.009009324945509434,
      "rmse_mean": 0.02216697856783867,
      "rotation_flip": 0.012690355069935322,
      "sparse_tokens": 14043.0,
      "step": 11509,
      "turn_loss": 0.16935712099075317,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 15866.0,
      "epoch": 0.5347519048503996,
      "grad_norm": 0.7572885751724243,
      "learning_rate": 4.20881296368586e-08,
      "loss": 0.1491,
      "mae_dtheta": 0.03160138055682182,
      "mae_dx": 0.011488714255392551,
      "mae_dy": 0.0032086579594761133,
      "pose_mae_dtheta": 0.2543337643146515,
      "pose_mae_dx": 0.09930989146232605,
      "pose_mae_dy": 0.04424944147467613,
      "pose_rmse_dtheta": 0.4355914294719696,
      "pose_rmse_dx": 0.21938998997211456,
      "pose_rmse_dy": 0.09902915358543396,
      "pose_rmse_mean": 0.25133687257766724,
      "rmse_dtheta": 0.049196064472198486,
      "rmse_dx": 0.02393064834177494,
      "rmse_dy": 0.0060357581824064255,
      "rmse_mean": 0.026387490332126617,
      "rotation_flip": 0.010218977928161621,
      "sparse_tokens": 12608.0,
      "step": 11510,
      "turn_loss": 0.21793554723262787,
      "turns": 49.0,
      "turns_per_sample": 49.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.5347983646162423,
      "grad_norm": 0.4432699680328369,
      "learning_rate": 4.191710550694172e-08,
      "loss": 0.0991,
      "mae_dtheta": 0.027635250240564346,
      "mae_dx": 0.005271382629871368,
      "mae_dy": 0.003969760145992041,
      "pose_mae_dtheta": 0.2229795753955841,
      "pose_mae_dx": 0.05804907903075218,
      "pose_mae_dy": 0.06500827521085739,
      "pose_rmse_dtheta": 0.4262177348136902,
      "pose_rmse_dx": 0.14079467952251434,
      "pose_rmse_dy": 0.1989029496908188,
      "pose_rmse_mean": 0.25530514121055603,
      "rmse_dtheta": 0.04670043662190437,
      "rmse_dx": 0.013082518242299557,
      "rmse_dy": 0.008594926446676254,
      "rmse_mean": 0.022792628034949303,
      "rotation_flip": 0.011257035657763481,
      "sparse_tokens": 7796.0,
      "step": 11511,
      "turn_loss": 0.17437511682510376,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.5348448243820851,
      "grad_norm": 0.46246427297592163,
      "learning_rate": 4.1746428098422555e-08,
      "loss": 0.1336,
      "mae_dtheta": 0.03915379196405411,
      "mae_dx": 0.013603015802800655,
      "mae_dy": 0.0060728369280695915,
      "pose_mae_dtheta": 0.3140755891799927,
      "pose_mae_dx": 0.11408215761184692,
      "pose_mae_dy": 0.06149514019489288,
      "pose_rmse_dtheta": 0.5173519253730774,
      "pose_rmse_dx": 0.24355247616767883,
      "pose_rmse_dy": 0.1414206624031067,
      "pose_rmse_mean": 0.30077505111694336,
      "rmse_dtheta": 0.05756170302629471,
      "rmse_dx": 0.026920223608613014,
      "rmse_dy": 0.01292708795517683,
      "rmse_mean": 0.032469671219587326,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 13784.0,
      "step": 11512,
      "turn_loss": 0.3617583215236664,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.5348912841479279,
      "grad_norm": 0.5572032928466797,
      "learning_rate": 4.157609742323654e-08,
      "loss": 0.1255,
      "mae_dtheta": 0.011606668122112751,
      "mae_dx": 0.0019357063574716449,
      "mae_dy": 0.0029004693496972322,
      "pose_mae_dtheta": 0.06761054694652557,
      "pose_mae_dx": 0.021802188828587532,
      "pose_mae_dy": 0.024277033284306526,
      "pose_rmse_dtheta": 0.1766551285982132,
      "pose_rmse_dx": 0.04889162257313728,
      "pose_rmse_dy": 0.05363161861896515,
      "pose_rmse_mean": 0.0930594652891159,
      "rmse_dtheta": 0.026702385395765305,
      "rmse_dx": 0.004452904220670462,
      "rmse_dy": 0.00621806038543582,
      "rmse_mean": 0.012457783333957195,
      "rotation_flip": 0.006618133746087551,
      "sparse_tokens": 32201.0,
      "step": 11513,
      "turn_loss": 0.11679063737392426,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5349377439137707,
      "grad_norm": 0.4462082087993622,
      "learning_rate": 4.1406113493295815e-08,
      "loss": 0.1019,
      "mae_dtheta": 0.00866158027201891,
      "mae_dx": 0.0024107606150209904,
      "mae_dy": 0.0033526255283504725,
      "pose_mae_dtheta": 0.061043113470077515,
      "pose_mae_dx": 0.03529821336269379,
      "pose_mae_dy": 0.02723774127662182,
      "pose_rmse_dtheta": 0.1463327556848526,
      "pose_rmse_dx": 0.0909741148352623,
      "pose_rmse_dy": 0.0617283470928669,
      "pose_rmse_mean": 0.0996784120798111,
      "rmse_dtheta": 0.019135216251015663,
      "rmse_dx": 0.006184212863445282,
      "rmse_dy": 0.007262415252625942,
      "rmse_mean": 0.010860614478588104,
      "rotation_flip": 0.0022564874961972237,
      "sparse_tokens": 32089.0,
      "step": 11514,
      "turn_loss": 0.09002283215522766,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24911.0,
      "epoch": 0.5349842036796134,
      "grad_norm": 0.6877280473709106,
      "learning_rate": 4.123647632048644e-08,
      "loss": 0.165,
      "mae_dtheta": 0.032105911523103714,
      "mae_dx": 0.013558072037994862,
      "mae_dy": 0.006970466114580631,
      "pose_mae_dtheta": 0.2589249908924103,
      "pose_mae_dx": 0.11121754348278046,
      "pose_mae_dy": 0.07937144488096237,
      "pose_rmse_dtheta": 0.42843157052993774,
      "pose_rmse_dx": 0.2300465852022171,
      "pose_rmse_dy": 0.17783468961715698,
      "pose_rmse_mean": 0.27877095341682434,
      "rmse_dtheta": 0.04765147715806961,
      "rmse_dx": 0.026030857115983963,
      "rmse_dy": 0.013337026350200176,
      "rmse_mean": 0.029006455093622208,
      "rotation_flip": 0.013877551071345806,
      "sparse_tokens": 18943.0,
      "step": 11515,
      "turn_loss": 0.31647050380706787,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.5350306634454562,
      "grad_norm": 0.8923048973083496,
      "learning_rate": 4.1067185916672247e-08,
      "loss": 0.159,
      "mae_dtheta": 0.060408689081668854,
      "mae_dx": 0.012488202191889286,
      "mae_dy": 0.003942855168133974,
      "pose_mae_dtheta": 0.5110951662063599,
      "pose_mae_dx": 0.09675298631191254,
      "pose_mae_dy": 0.0316646434366703,
      "pose_rmse_dtheta": 0.8401398062705994,
      "pose_rmse_dx": 0.21797224879264832,
      "pose_rmse_dy": 0.07733998447656631,
      "pose_rmse_mean": 0.37848401069641113,
      "rmse_dtheta": 0.08250540494918823,
      "rmse_dx": 0.024092409759759903,
      "rmse_dy": 0.008579171262681484,
      "rmse_mean": 0.0383923277258873,
      "rotation_flip": 0.0044247787445783615,
      "sparse_tokens": 3296.0,
      "step": 11516,
      "turn_loss": 0.2634509205818176,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 28462.0,
      "epoch": 0.535077123211299,
      "grad_norm": 0.40140804648399353,
      "learning_rate": 4.0898242293691546e-08,
      "loss": 0.0996,
      "mae_dtheta": 0.036126792430877686,
      "mae_dx": 0.011396916583180428,
      "mae_dy": 0.0030510625801980495,
      "pose_mae_dtheta": 0.3161792755126953,
      "pose_mae_dx": 0.09385771304368973,
      "pose_mae_dy": 0.03623704984784126,
      "pose_rmse_dtheta": 0.583486020565033,
      "pose_rmse_dx": 0.21680696308612823,
      "pose_rmse_dy": 0.08173824101686478,
      "pose_rmse_mean": 0.2940104007720947,
      "rmse_dtheta": 0.056763868778944016,
      "rmse_dx": 0.023656733334064484,
      "rmse_dy": 0.0058373864740133286,
      "rmse_mean": 0.028752662241458893,
      "rotation_flip": 0.010152284055948257,
      "sparse_tokens": 22566.0,
      "step": 11517,
      "turn_loss": 0.22496852278709412,
      "turns": 88.0,
      "turns_per_sample": 88.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5351235829771418,
      "grad_norm": 0.37555959820747375,
      "learning_rate": 4.072964546335823e-08,
      "loss": 0.074,
      "mae_dtheta": 0.009248686954379082,
      "mae_dx": 0.0016967739211395383,
      "mae_dy": 0.0018895982066169381,
      "pose_mae_dtheta": 0.06162464618682861,
      "pose_mae_dx": 0.02095218375325203,
      "pose_mae_dy": 0.02243686653673649,
      "pose_rmse_dtheta": 0.1794566810131073,
      "pose_rmse_dx": 0.07020432502031326,
      "pose_rmse_dy": 0.07141591608524323,
      "pose_rmse_mean": 0.107025645673275,
      "rmse_dtheta": 0.023707209154963493,
      "rmse_dx": 0.005399393383413553,
      "rmse_dy": 0.005383616778999567,
      "rmse_mean": 0.011496740393340588,
      "rotation_flip": 0.00501253129914403,
      "sparse_tokens": 32089.0,
      "step": 11518,
      "turn_loss": 0.08272737264633179,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 32114.0,
      "epoch": 0.5351700427429846,
      "grad_norm": 0.7101936936378479,
      "learning_rate": 4.056139543746285e-08,
      "loss": 0.2226,
      "mae_dtheta": 0.02743966318666935,
      "mae_dx": 0.010574489831924438,
      "mae_dy": 0.0043530636467039585,
      "pose_mae_dtheta": 0.19974420964717865,
      "pose_mae_dx": 0.09242536872625351,
      "pose_mae_dy": 0.05274313688278198,
      "pose_rmse_dtheta": 0.3835690915584564,
      "pose_rmse_dx": 0.2160763442516327,
      "pose_rmse_dy": 0.12598028779029846,
      "pose_rmse_mean": 0.24187526106834412,
      "rmse_dtheta": 0.04595058038830757,
      "rmse_dx": 0.022981693968176842,
      "rmse_dy": 0.009202645160257816,
      "rmse_mean": 0.026044972240924835,
      "rotation_flip": 0.015532544814050198,
      "sparse_tokens": 26140.0,
      "step": 11519,
      "turn_loss": 0.18215303122997284,
      "turns": 99.0,
      "turns_per_sample": 99.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5352165025088274,
      "grad_norm": 0.32402312755584717,
      "learning_rate": 4.039349222777045e-08,
      "loss": 0.0639,
      "mae_dtheta": 0.006877175997942686,
      "mae_dx": 0.0015347566222772002,
      "mae_dy": 0.00046604525414295495,
      "pose_mae_dtheta": 0.04698668047785759,
      "pose_mae_dx": 0.014105780981481075,
      "pose_mae_dy": 0.007033091504126787,
      "pose_rmse_dtheta": 0.21080803871154785,
      "pose_rmse_dx": 0.04773273691534996,
      "pose_rmse_dy": 0.01823200285434723,
      "pose_rmse_mean": 0.09225760400295258,
      "rmse_dtheta": 0.02558596432209015,
      "rmse_dx": 0.005447048228234053,
      "rmse_dy": 0.0011452310718595982,
      "rmse_mean": 0.010726082138717175,
      "rotation_flip": 0.001891551073640585,
      "sparse_tokens": 32137.0,
      "step": 11520,
      "turn_loss": 0.046154167503118515,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5352629622746702,
      "grad_norm": 0.35371237993240356,
      "learning_rate": 4.02259358460233e-08,
      "loss": 0.0702,
      "mae_dtheta": 0.008320043794810772,
      "mae_dx": 0.001828125910833478,
      "mae_dy": 0.002383447252213955,
      "pose_mae_dtheta": 0.05718306079506874,
      "pose_mae_dx": 0.02318616770207882,
      "pose_mae_dy": 0.02857111766934395,
      "pose_rmse_dtheta": 0.13913093507289886,
      "pose_rmse_dx": 0.05923374369740486,
      "pose_rmse_dy": 0.06914601475000381,
      "pose_rmse_mean": 0.08917023241519928,
      "rmse_dtheta": 0.019153403118252754,
      "rmse_dx": 0.0055582462809979916,
      "rmse_dy": 0.00576107669621706,
      "rmse_mean": 0.010157575830817223,
      "rotation_flip": 0.0037558686453849077,
      "sparse_tokens": 32073.0,
      "step": 11521,
      "turn_loss": 0.0798177421092987,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22070.0,
      "epoch": 0.5353094220405129,
      "grad_norm": 0.9833034873008728,
      "learning_rate": 4.00587263039387e-08,
      "loss": 0.25,
      "mae_dtheta": 0.017071256414055824,
      "mae_dx": 0.007012628950178623,
      "mae_dy": 0.0030149465892463923,
      "pose_mae_dtheta": 0.13799209892749786,
      "pose_mae_dx": 0.0591079480946064,
      "pose_mae_dy": 0.04874466359615326,
      "pose_rmse_dtheta": 0.3026043772697449,
      "pose_rmse_dx": 0.15859024226665497,
      "pose_rmse_dy": 0.13387395441532135,
      "pose_rmse_mean": 0.19835619628429413,
      "rmse_dtheta": 0.032809894531965256,
      "rmse_dx": 0.018445361405611038,
      "rmse_dy": 0.006377653684467077,
      "rmse_mean": 0.019210970029234886,
      "rotation_flip": 0.0017152659129351377,
      "sparse_tokens": 16151.0,
      "step": 11522,
      "turn_loss": 0.13456758856773376,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 11378.0,
      "epoch": 0.5353558818063557,
      "grad_norm": 0.7314922213554382,
      "learning_rate": 3.989186361321007e-08,
      "loss": 0.1741,
      "mae_dtheta": 0.03129899874329567,
      "mae_dx": 0.008358679711818695,
      "mae_dy": 0.004608146380633116,
      "pose_mae_dtheta": 0.21633784472942352,
      "pose_mae_dx": 0.07640994340181351,
      "pose_mae_dy": 0.04188017547130585,
      "pose_rmse_dtheta": 0.4351341128349304,
      "pose_rmse_dx": 0.16480696201324463,
      "pose_rmse_dy": 0.11919073015451431,
      "pose_rmse_mean": 0.23971061408519745,
      "rmse_dtheta": 0.05190705880522728,
      "rmse_dx": 0.01871320605278015,
      "rmse_dy": 0.011913790367543697,
      "rmse_mean": 0.0275113545358181,
      "rotation_flip": 0.012219958938658237,
      "sparse_tokens": 8596.0,
      "step": 11523,
      "turn_loss": 0.28963950276374817,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.5354023415721985,
      "grad_norm": 0.629501223564148,
      "learning_rate": 3.972534778550474e-08,
      "loss": 0.1893,
      "mae_dtheta": 0.032789066433906555,
      "mae_dx": 0.01407756470143795,
      "mae_dy": 0.005529320333153009,
      "pose_mae_dtheta": 0.26019808650016785,
      "pose_mae_dx": 0.11791940778493881,
      "pose_mae_dy": 0.058472633361816406,
      "pose_rmse_dtheta": 0.4502122104167938,
      "pose_rmse_dx": 0.24701541662216187,
      "pose_rmse_dy": 0.1309368759393692,
      "pose_rmse_mean": 0.27605482935905457,
      "rmse_dtheta": 0.050505705177783966,
      "rmse_dx": 0.02782801352441311,
      "rmse_dy": 0.01019554678350687,
      "rmse_mean": 0.029509756714105606,
      "rotation_flip": 0.009957325644791126,
      "sparse_tokens": 10966.0,
      "step": 11524,
      "turn_loss": 0.3055412769317627,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5354488013380413,
      "grad_norm": 0.2941764295101166,
      "learning_rate": 3.955917883246896e-08,
      "loss": 0.0642,
      "mae_dtheta": 0.00852825678884983,
      "mae_dx": 0.0013697217218577862,
      "mae_dy": 0.0021786733996123075,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.2941763997077942,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.6830291748047,
      "model/head/act_norm_mean": 112.83130129419192,
      "model/head/act_norm_min": 65.88643646240234,
      "model/head/act_over_embed": 77.53872659265436,
      "model/head/grad_frac": 0.09988564252853394,
      "model/head/grad_norm": 0.02938399836421013,
      "model/head/grad_zero_frac": 0.00022589750005863607,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7056157275883839,
      "model/head/update_ratio": 0.0005001965328119695,
      "model/head/weight_delta": 9.985674858093262,
      "model/head/weight_delta_rel": 0.17517831921577454,
      "model/head/weight_norm": 58.74490737915039,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229450225830078,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228677707248264,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227975308895111,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905986909925445,
      "model/modality_embedder.encoders.pose/grad_frac": 0.11071458458900452,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03256961703300476,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5292013888888889,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001051655039191246,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569273471832275,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314665734767914,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969865798950195,
      "model/modality_embedder/grad_frac": 0.11071458458900452,
      "model/modality_embedder/grad_norm": 0.03256961703300476,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5292013888888889,
      "model/modality_embedder/update_ratio": 0.001051655039191246,
      "model/modality_embedder/weight_delta": 3.1569273471832275,
      "model/modality_embedder/weight_delta_rel": 0.10314665734767914,
      "model/modality_embedder/weight_norm": 30.969865798950195,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.64730072021484,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.945877425044092,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.074442863464355,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.455831151326844,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06116342917084694,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.017992837354540825,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0006434925016947091,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7426719665527344,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09994462132453918,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961223602294922,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.38611602783203,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.938885381593714,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.440035820007324,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.138235515754705,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06287802755832672,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.018497232347726822,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002269609394716099,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0006213192245922983,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.477362632751465,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12045855820178986,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770898818969727,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.1924819946289,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.759835457752125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.609167098999023,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.38960945609397,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06364742666482925,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.018723569810390472,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0006090457900427282,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7673215866088867,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12649960815906525,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.74246597290039,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.79632568359375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.469521604938272,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.639080047607422,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.564521782774186,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07093136012554169,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.020866332575678825,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002017430670093745,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006965721258893609,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2384183406829834,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11067377030849457,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955738067626953,
      "model/normalizer/grad_frac": 0.26105427742004395,
      "model/normalizer/grad_norm": 0.07679601013660431,
      "model/normalizer/grad_zero_frac": 0.00021389465837273747,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0009763272246345878,
      "model/normalizer/weight_delta": 6.810244083404541,
      "model/normalizer/weight_delta_rel": 0.08771199733018875,
      "model/normalizer/weight_norm": 78.65806579589844,
      "pose_mae_dtheta": 0.05630512535572052,
      "pose_mae_dx": 0.01515282690525055,
      "pose_mae_dy": 0.01982494816184044,
      "pose_rmse_dtheta": 0.15626317262649536,
      "pose_rmse_dx": 0.0409969799220562,
      "pose_rmse_dy": 0.04622062295675278,
      "pose_rmse_mean": 0.08116026222705841,
      "rmse_dtheta": 0.02168889157474041,
      "rmse_dx": 0.004723565187305212,
      "rmse_dy": 0.005758368410170078,
      "rmse_mean": 0.010723608545958996,
      "rotation_flip": 0.007506914436817169,
      "sparse_tokens": 32121.0,
      "step": 11525,
      "turn_loss": 0.07035209238529205,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16511.0,
      "epoch": 0.535495261103884,
      "grad_norm": 1.068942904472351,
      "learning_rate": 3.9393356765721757e-08,
      "loss": 0.2975,
      "mae_dtheta": 0.041593752801418304,
      "mae_dx": 0.014005937613546848,
      "mae_dy": 0.007890083827078342,
      "pose_mae_dtheta": 0.3559907376766205,
      "pose_mae_dx": 0.11296393722295761,
      "pose_mae_dy": 0.08826307952404022,
      "pose_rmse_dtheta": 0.5862435698509216,
      "pose_rmse_dx": 0.22911322116851807,
      "pose_rmse_dy": 0.23397357761859894,
      "pose_rmse_mean": 0.3497768044471741,
      "rmse_dtheta": 0.059141941368579865,
      "rmse_dx": 0.026487495750188828,
      "rmse_dy": 0.016300400719046593,
      "rmse_mean": 0.033976614475250244,
      "rotation_flip": 0.017766498029232025,
      "sparse_tokens": 13780.0,
      "step": 11526,
      "turn_loss": 0.3177769184112549,
      "turns": 51.0,
      "turns_per_sample": 51.0
    },
    {
      "dense_tokens": 35255.0,
      "epoch": 0.5355417208697268,
      "grad_norm": 0.550830066204071,
      "learning_rate": 3.922788159685942e-08,
      "loss": 0.1644,
      "mae_dtheta": 0.03413163125514984,
      "mae_dx": 0.013348158448934555,
      "mae_dy": 0.005652973428368568,
      "pose_mae_dtheta": 0.28749018907546997,
      "pose_mae_dx": 0.09849466383457184,
      "pose_mae_dy": 0.07902290672063828,
      "pose_rmse_dtheta": 0.48985812067985535,
      "pose_rmse_dx": 0.21487906575202942,
      "pose_rmse_dy": 0.1977948546409607,
      "pose_rmse_mean": 0.3008440136909485,
      "rmse_dtheta": 0.05067433416843414,
      "rmse_dx": 0.026162832975387573,
      "rmse_dy": 0.012044360861182213,
      "rmse_mean": 0.029627177864313126,
      "rotation_flip": 0.013253011740744114,
      "sparse_tokens": 27251.0,
      "step": 11527,
      "turn_loss": 0.26429039239883423,
      "turns": 109.0,
      "turns_per_sample": 109.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.5355881806355696,
      "grad_norm": 0.3944307267665863,
      "learning_rate": 3.9062753337454354e-08,
      "loss": 0.0902,
      "mae_dtheta": 0.030373767018318176,
      "mae_dx": 0.011743064969778061,
      "mae_dy": 0.00532293226569891,
      "pose_mae_dtheta": 0.22315818071365356,
      "pose_mae_dx": 0.09172067046165466,
      "pose_mae_dy": 0.06862999498844147,
      "pose_rmse_dtheta": 0.4025735855102539,
      "pose_rmse_dx": 0.21152573823928833,
      "pose_rmse_dy": 0.15897904336452484,
      "pose_rmse_mean": 0.257692813873291,
      "rmse_dtheta": 0.047590695321559906,
      "rmse_dx": 0.02390936203300953,
      "rmse_dy": 0.010441138409078121,
      "rmse_mean": 0.027313731610774994,
      "rotation_flip": 0.009719222784042358,
      "sparse_tokens": 17573.0,
      "step": 11528,
      "turn_loss": 0.26080137491226196,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5356346404014124,
      "grad_norm": 0.3596636950969696,
      "learning_rate": 3.889797199905343e-08,
      "loss": 0.088,
      "mae_dtheta": 0.008829854428768158,
      "mae_dx": 0.0012332259211689234,
      "mae_dy": 0.0024551404640078545,
      "pose_mae_dtheta": 0.053339723497629166,
      "pose_mae_dx": 0.01778952218592167,
      "pose_mae_dy": 0.02708214335143566,
      "pose_rmse_dtheta": 0.11131124198436737,
      "pose_rmse_dx": 0.05496004596352577,
      "pose_rmse_dy": 0.06299301236867905,
      "pose_rmse_mean": 0.07642143219709396,
      "rmse_dtheta": 0.01842387579381466,
      "rmse_dx": 0.004066396038979292,
      "rmse_dy": 0.0058830250054597855,
      "rmse_mean": 0.009457766078412533,
      "rotation_flip": 0.0033264034427702427,
      "sparse_tokens": 32041.0,
      "step": 11529,
      "turn_loss": 0.07575973123311996,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.5356811001672551,
      "grad_norm": 0.5375846028327942,
      "learning_rate": 3.873353759318021e-08,
      "loss": 0.154,
      "mae_dtheta": 0.03988330438733101,
      "mae_dx": 0.0076109543442726135,
      "mae_dy": 0.005696658045053482,
      "pose_mae_dtheta": 0.27318382263183594,
      "pose_mae_dx": 0.05914697423577309,
      "pose_mae_dy": 0.07959102094173431,
      "pose_rmse_dtheta": 0.45895662903785706,
      "pose_rmse_dx": 0.16717976331710815,
      "pose_rmse_dy": 0.16347163915634155,
      "pose_rmse_mean": 0.2632026970386505,
      "rmse_dtheta": 0.054967980831861496,
      "rmse_dx": 0.018046634271740913,
      "rmse_dy": 0.010590304620563984,
      "rmse_mean": 0.027868308126926422,
      "rotation_flip": 0.015075377188622952,
      "sparse_tokens": 3713.0,
      "step": 11530,
      "turn_loss": 0.33076947927474976,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.535727559933098,
      "grad_norm": 0.343095064163208,
      "learning_rate": 3.856945013133384e-08,
      "loss": 0.0864,
      "mae_dtheta": 0.03916165605187416,
      "mae_dx": 0.008308847434818745,
      "mae_dy": 0.008426911197602749,
      "pose_mae_dtheta": 0.3116113245487213,
      "pose_mae_dx": 0.09271517395973206,
      "pose_mae_dy": 0.11216552555561066,
      "pose_rmse_dtheta": 0.5730499029159546,
      "pose_rmse_dx": 0.1980689913034439,
      "pose_rmse_dy": 0.2735441029071808,
      "pose_rmse_mean": 0.3482210040092468,
      "rmse_dtheta": 0.05912500619888306,
      "rmse_dx": 0.018408354371786118,
      "rmse_dy": 0.015599329955875874,
      "rmse_mean": 0.031044233590364456,
      "rotation_flip": 0.009140768088400364,
      "sparse_tokens": 8351.0,
      "step": 11531,
      "turn_loss": 0.24913695454597473,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.5357740196989407,
      "grad_norm": 0.41862255334854126,
      "learning_rate": 3.8405709624988465e-08,
      "loss": 0.0849,
      "mae_dtheta": 0.03505226969718933,
      "mae_dx": 0.007882384583353996,
      "mae_dy": 0.004163539502769709,
      "pose_mae_dtheta": 0.27469345927238464,
      "pose_mae_dx": 0.055583514273166656,
      "pose_mae_dy": 0.031144985929131508,
      "pose_rmse_dtheta": 0.5209918022155762,
      "pose_rmse_dx": 0.132743701338768,
      "pose_rmse_dy": 0.06977976858615875,
      "pose_rmse_mean": 0.24117176234722137,
      "rmse_dtheta": 0.05624399706721306,
      "rmse_dx": 0.016819709911942482,
      "rmse_dy": 0.007514062337577343,
      "rmse_mean": 0.026859257370233536,
      "rotation_flip": 0.012987012974917889,
      "sparse_tokens": 5436.0,
      "step": 11532,
      "turn_loss": 0.25251510739326477,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 6194.0,
      "epoch": 0.5358204794647835,
      "grad_norm": 0.6082441210746765,
      "learning_rate": 3.8242316085594923e-08,
      "loss": 0.1317,
      "mae_dtheta": 0.02376171573996544,
      "mae_dx": 0.00672113848850131,
      "mae_dy": 0.004940045066177845,
      "pose_mae_dtheta": 0.19658787548542023,
      "pose_mae_dx": 0.06504786014556885,
      "pose_mae_dy": 0.021013746038079262,
      "pose_rmse_dtheta": 0.37695667147636414,
      "pose_rmse_dx": 0.17222216725349426,
      "pose_rmse_dy": 0.0489376075565815,
      "pose_rmse_mean": 0.19937215745449066,
      "rmse_dtheta": 0.04271849989891052,
      "rmse_dx": 0.014480513520538807,
      "rmse_dy": 0.013425787910819054,
      "rmse_mean": 0.02354159951210022,
      "rotation_flip": 0.00958466436713934,
      "sparse_tokens": 4774.0,
      "step": 11533,
      "turn_loss": 0.22076602280139923,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5358669392306262,
      "grad_norm": 0.3529731333255768,
      "learning_rate": 3.807926952457963e-08,
      "loss": 0.1058,
      "mae_dtheta": 0.012210685759782791,
      "mae_dx": 0.002234810497611761,
      "mae_dy": 0.0034855103585869074,
      "pose_mae_dtheta": 0.07622634619474411,
      "pose_mae_dx": 0.03108077123761177,
      "pose_mae_dy": 0.03956717252731323,
      "pose_rmse_dtheta": 0.1634378880262375,
      "pose_rmse_dx": 0.08643267303705215,
      "pose_rmse_dy": 0.11156419664621353,
      "pose_rmse_mean": 0.12047825753688812,
      "rmse_dtheta": 0.02300211973488331,
      "rmse_dx": 0.0070563675835728645,
      "rmse_dy": 0.008295245468616486,
      "rmse_mean": 0.012784577906131744,
      "rotation_flip": 0.007338864263147116,
      "sparse_tokens": 32073.0,
      "step": 11534,
      "turn_loss": 0.11779019236564636,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9110.0,
      "epoch": 0.5359133989964691,
      "grad_norm": 0.496138334274292,
      "learning_rate": 3.791656995334403e-08,
      "loss": 0.0819,
      "mae_dtheta": 0.030066462233662605,
      "mae_dx": 0.00873755756765604,
      "mae_dy": 0.006699302699416876,
      "pose_mae_dtheta": 0.19915176928043365,
      "pose_mae_dx": 0.07408075034618378,
      "pose_mae_dy": 0.059648916125297546,
      "pose_rmse_dtheta": 0.3532913327217102,
      "pose_rmse_dx": 0.16078078746795654,
      "pose_rmse_dy": 0.09615714848041534,
      "pose_rmse_mean": 0.20340976119041443,
      "rmse_dtheta": 0.0458197258412838,
      "rmse_dx": 0.019302956759929657,
      "rmse_dy": 0.011951071210205555,
      "rmse_mean": 0.025691252201795578,
      "rotation_flip": 0.011210761964321136,
      "sparse_tokens": 7484.0,
      "step": 11535,
      "turn_loss": 0.27868446707725525,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5359598587623119,
      "grad_norm": 0.40318432450294495,
      "learning_rate": 3.775421738326568e-08,
      "loss": 0.0997,
      "mae_dtheta": 0.011663385666906834,
      "mae_dx": 0.0013726955512538552,
      "mae_dy": 0.0025612874887883663,
      "pose_mae_dtheta": 0.0675409659743309,
      "pose_mae_dx": 0.019509322941303253,
      "pose_mae_dy": 0.027132879942655563,
      "pose_rmse_dtheta": 0.1433153748512268,
      "pose_rmse_dx": 0.051363505423069,
      "pose_rmse_dy": 0.05519716069102287,
      "pose_rmse_mean": 0.08329201489686966,
      "rmse_dtheta": 0.022643838077783585,
      "rmse_dx": 0.0041773500852286816,
      "rmse_dy": 0.005428314208984375,
      "rmse_mean": 0.010749834589660168,
      "rotation_flip": 0.005352644715458155,
      "sparse_tokens": 32105.0,
      "step": 11536,
      "turn_loss": 0.08449999243021011,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5360063185281546,
      "grad_norm": 0.5627853870391846,
      "learning_rate": 3.7592211825698835e-08,
      "loss": 0.1227,
      "mae_dtheta": 0.011332630179822445,
      "mae_dx": 0.0014934658538550138,
      "mae_dy": 0.0015338524244725704,
      "pose_mae_dtheta": 0.07282085716724396,
      "pose_mae_dx": 0.01532953791320324,
      "pose_mae_dy": 0.02159937284886837,
      "pose_rmse_dtheta": 0.224734827876091,
      "pose_rmse_dx": 0.032346419990062714,
      "pose_rmse_dy": 0.05291828513145447,
      "pose_rmse_mean": 0.10333317518234253,
      "rmse_dtheta": 0.02867325022816658,
      "rmse_dx": 0.0043129888363182545,
      "rmse_dy": 0.0034591001458466053,
      "rmse_mean": 0.012148446403443813,
      "rotation_flip": 0.0028409091755747795,
      "sparse_tokens": 32105.0,
      "step": 11537,
      "turn_loss": 0.08767648786306381,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15219.0,
      "epoch": 0.5360527782939974,
      "grad_norm": 0.4317507743835449,
      "learning_rate": 3.74305532919722e-08,
      "loss": 0.1025,
      "mae_dtheta": 0.029385019093751907,
      "mae_dx": 0.012100412510335445,
      "mae_dy": 0.004089402500540018,
      "pose_mae_dtheta": 0.2073468416929245,
      "pose_mae_dx": 0.0854916125535965,
      "pose_mae_dy": 0.05278731882572174,
      "pose_rmse_dtheta": 0.4133416712284088,
      "pose_rmse_dx": 0.19554564356803894,
      "pose_rmse_dy": 0.11827413737773895,
      "pose_rmse_mean": 0.24238716065883636,
      "rmse_dtheta": 0.04729825258255005,
      "rmse_dx": 0.025057170540094376,
      "rmse_dy": 0.0070926775224506855,
      "rmse_mean": 0.026482699438929558,
      "rotation_flip": 0.02620689570903778,
      "sparse_tokens": 12344.0,
      "step": 11538,
      "turn_loss": 0.21244625747203827,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.5360992380598402,
      "grad_norm": 0.6512853503227234,
      "learning_rate": 3.726924179339009e-08,
      "loss": 0.1662,
      "mae_dtheta": 0.032368771731853485,
      "mae_dx": 0.011350472457706928,
      "mae_dy": 0.002928553381934762,
      "pose_mae_dtheta": 0.24577918648719788,
      "pose_mae_dx": 0.09013912081718445,
      "pose_mae_dy": 0.034856412559747696,
      "pose_rmse_dtheta": 0.46134501695632935,
      "pose_rmse_dx": 0.23496484756469727,
      "pose_rmse_dy": 0.09075627475976944,
      "pose_rmse_mean": 0.26235538721084595,
      "rmse_dtheta": 0.05125553160905838,
      "rmse_dx": 0.024898197501897812,
      "rmse_dy": 0.006066054105758667,
      "rmse_mean": 0.027406593784689903,
      "rotation_flip": 0.014592275023460388,
      "sparse_tokens": 20382.0,
      "step": 11539,
      "turn_loss": 0.2527201771736145,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.536145697825683,
      "grad_norm": 0.5218414068222046,
      "learning_rate": 3.710827734123346e-08,
      "loss": 0.1478,
      "mae_dtheta": 0.010706555098295212,
      "mae_dx": 0.0019677961245179176,
      "mae_dy": 0.003395817708224058,
      "pose_mae_dtheta": 0.065847247838974,
      "pose_mae_dx": 0.025429915636777878,
      "pose_mae_dy": 0.03146879002451897,
      "pose_rmse_dtheta": 0.19159448146820068,
      "pose_rmse_dx": 0.0686793103814125,
      "pose_rmse_dy": 0.07360626012086868,
      "pose_rmse_mean": 0.11129334568977356,
      "rmse_dtheta": 0.02338573895394802,
      "rmse_dx": 0.0050683412700891495,
      "rmse_dy": 0.007875891402363777,
      "rmse_mean": 0.012109990231692791,
      "rotation_flip": 0.005602241028100252,
      "sparse_tokens": 32105.0,
      "step": 11540,
      "turn_loss": 0.10711705684661865,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5361921575915257,
      "grad_norm": 0.6777188181877136,
      "learning_rate": 3.694765994675886e-08,
      "loss": 0.1477,
      "mae_dtheta": 0.005852927919477224,
      "mae_dx": 0.001282336306758225,
      "mae_dy": 0.0011992640793323517,
      "pose_mae_dtheta": 0.03918299823999405,
      "pose_mae_dx": 0.013558211736381054,
      "pose_mae_dy": 0.01626414991915226,
      "pose_rmse_dtheta": 0.11974889785051346,
      "pose_rmse_dx": 0.0516851469874382,
      "pose_rmse_dy": 0.06010852009057999,
      "pose_rmse_mean": 0.07718085497617722,
      "rmse_dtheta": 0.01666119694709778,
      "rmse_dx": 0.005285230465233326,
      "rmse_dy": 0.0035326897632330656,
      "rmse_mean": 0.008493038825690746,
      "rotation_flip": 0.008148147724568844,
      "sparse_tokens": 32057.0,
      "step": 11541,
      "turn_loss": 0.046814341098070145,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5362386173573686,
      "grad_norm": 0.4065950810909271,
      "learning_rate": 3.678738962119899e-08,
      "loss": 0.0908,
      "mae_dtheta": 0.007026268169283867,
      "mae_dx": 0.0011752552818506956,
      "mae_dy": 0.0013838271843269467,
      "pose_mae_dtheta": 0.04899795725941658,
      "pose_mae_dx": 0.01600155606865883,
      "pose_mae_dy": 0.02037716656923294,
      "pose_rmse_dtheta": 0.13755150139331818,
      "pose_rmse_dx": 0.056334301829338074,
      "pose_rmse_dy": 0.06401041150093079,
      "pose_rmse_mean": 0.08596540987491608,
      "rmse_dtheta": 0.017837876453995705,
      "rmse_dx": 0.005265471991151571,
      "rmse_dy": 0.0036968351341784,
      "rmse_mean": 0.008933395147323608,
      "rotation_flip": 0.0011827320558950305,
      "sparse_tokens": 32057.0,
      "step": 11542,
      "turn_loss": 0.060010578483343124,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5362850771232113,
      "grad_norm": 0.3169722855091095,
      "learning_rate": 3.6627466375759867e-08,
      "loss": 0.0904,
      "mae_dtheta": 0.008433492854237556,
      "mae_dx": 0.002542252419516444,
      "mae_dy": 0.00289840716868639,
      "pose_mae_dtheta": 0.057969268411397934,
      "pose_mae_dx": 0.022721705958247185,
      "pose_mae_dy": 0.022069429978728294,
      "pose_rmse_dtheta": 0.16188322007656097,
      "pose_rmse_dx": 0.0658378079533577,
      "pose_rmse_dy": 0.053208209574222565,
      "pose_rmse_mean": 0.09364308416843414,
      "rmse_dtheta": 0.02077903412282467,
      "rmse_dx": 0.010184497572481632,
      "rmse_dy": 0.007912308908998966,
      "rmse_mean": 0.012958614155650139,
      "rotation_flip": 0.004807692486792803,
      "sparse_tokens": 32057.0,
      "step": 11543,
      "turn_loss": 0.0839814767241478,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5363315368890541,
      "grad_norm": 0.31212830543518066,
      "learning_rate": 3.6467890221626446e-08,
      "loss": 0.0638,
      "mae_dtheta": 0.007890209555625916,
      "mae_dx": 0.0011501866392791271,
      "mae_dy": 0.001776901539415121,
      "pose_mae_dtheta": 0.051980093121528625,
      "pose_mae_dx": 0.015996089205145836,
      "pose_mae_dy": 0.02138836309313774,
      "pose_rmse_dtheta": 0.1624310463666916,
      "pose_rmse_dx": 0.04458145052194595,
      "pose_rmse_dy": 0.06122715398669243,
      "pose_rmse_mean": 0.08941321820020676,
      "rmse_dtheta": 0.020291484892368317,
      "rmse_dx": 0.003574750619009137,
      "rmse_dy": 0.005345175042748451,
      "rmse_mean": 0.009737137705087662,
      "rotation_flip": 0.003970004618167877,
      "sparse_tokens": 32089.0,
      "step": 11544,
      "turn_loss": 0.060853566974401474,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5363779966548968,
      "grad_norm": 0.7911027073860168,
      "learning_rate": 3.630866116995757e-08,
      "loss": 0.1523,
      "mae_dtheta": 0.009647723287343979,
      "mae_dx": 0.001178150181658566,
      "mae_dy": 0.0017406935803592205,
      "pose_mae_dtheta": 0.05598312243819237,
      "pose_mae_dx": 0.015852732583880424,
      "pose_mae_dy": 0.02285567857325077,
      "pose_rmse_dtheta": 0.13351143896579742,
      "pose_rmse_dx": 0.04153408110141754,
      "pose_rmse_dy": 0.05587029829621315,
      "pose_rmse_mean": 0.07697194069623947,
      "rmse_dtheta": 0.02009548246860504,
      "rmse_dx": 0.0041322554461658,
      "rmse_dy": 0.0035852743312716484,
      "rmse_mean": 0.009271005168557167,
      "rotation_flip": 0.004101417027413845,
      "sparse_tokens": 32089.0,
      "step": 11545,
      "turn_loss": 0.07512958347797394,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 28875.0,
      "epoch": 0.5364244564207397,
      "grad_norm": 0.6946554780006409,
      "learning_rate": 3.614977923188823e-08,
      "loss": 0.1348,
      "mae_dtheta": 0.03419679030776024,
      "mae_dx": 0.015458187088370323,
      "mae_dy": 0.0064453682862222195,
      "pose_mae_dtheta": 0.272821307182312,
      "pose_mae_dx": 0.1136641725897789,
      "pose_mae_dy": 0.05924628674983978,
      "pose_rmse_dtheta": 0.4428026080131531,
      "pose_rmse_dx": 0.23864588141441345,
      "pose_rmse_dy": 0.1461883932352066,
      "pose_rmse_mean": 0.2758789658546448,
      "rmse_dtheta": 0.050488125532865524,
      "rmse_dx": 0.02831161767244339,
      "rmse_dy": 0.013578906655311584,
      "rmse_mean": 0.030792882665991783,
      "rotation_flip": 0.015317286364734173,
      "sparse_tokens": 23414.0,
      "step": 11546,
      "turn_loss": 0.288650780916214,
      "turns": 89.0,
      "turns_per_sample": 89.0
    },
    {
      "dense_tokens": 8438.0,
      "epoch": 0.5364709161865824,
      "grad_norm": 0.7646804451942444,
      "learning_rate": 3.599124441852897e-08,
      "loss": 0.1447,
      "mae_dtheta": 0.031751543283462524,
      "mae_dx": 0.011024534702301025,
      "mae_dy": 0.004516495391726494,
      "pose_mae_dtheta": 0.25841832160949707,
      "pose_mae_dx": 0.10589682310819626,
      "pose_mae_dy": 0.06318290531635284,
      "pose_rmse_dtheta": 0.4331689774990082,
      "pose_rmse_dx": 0.22530384361743927,
      "pose_rmse_dy": 0.12515901029109955,
      "pose_rmse_mean": 0.2612106204032898,
      "rmse_dtheta": 0.04917537048459053,
      "rmse_dx": 0.02329961024224758,
      "rmse_dy": 0.009617804549634457,
      "rmse_mean": 0.02736426144838333,
      "rotation_flip": 0.01425178162753582,
      "sparse_tokens": 6941.0,
      "step": 11547,
      "turn_loss": 0.3057948648929596,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.5365173759524252,
      "grad_norm": 1.5470892190933228,
      "learning_rate": 3.583305674096649e-08,
      "loss": 0.2793,
      "mae_dtheta": 0.04815981537103653,
      "mae_dx": 0.015872454270720482,
      "mae_dy": 0.004460461437702179,
      "pose_mae_dtheta": 0.4212527573108673,
      "pose_mae_dx": 0.12104704976081848,
      "pose_mae_dy": 0.05413835123181343,
      "pose_rmse_dtheta": 0.6808471083641052,
      "pose_rmse_dx": 0.2694087326526642,
      "pose_rmse_dy": 0.13035988807678223,
      "pose_rmse_mean": 0.3602052628993988,
      "rmse_dtheta": 0.06708860397338867,
      "rmse_dx": 0.029432019218802452,
      "rmse_dy": 0.008531992323696613,
      "rmse_mean": 0.03501754254102707,
      "rotation_flip": 0.018309859558939934,
      "sparse_tokens": 13993.0,
      "step": 11548,
      "turn_loss": 0.26233842968940735,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5365638357182679,
      "grad_norm": 0.7232714891433716,
      "learning_rate": 3.5675216210262485e-08,
      "loss": 0.229,
      "mae_dtheta": 0.011470216326415539,
      "mae_dx": 0.0041487496346235275,
      "mae_dy": 0.003428948810324073,
      "pose_mae_dtheta": 0.07529399544000626,
      "pose_mae_dx": 0.03559033200144768,
      "pose_mae_dy": 0.037276897579431534,
      "pose_rmse_dtheta": 0.23257437348365784,
      "pose_rmse_dx": 0.09421828389167786,
      "pose_rmse_dy": 0.10547853261232376,
      "pose_rmse_mean": 0.14409039914608002,
      "rmse_dtheta": 0.031498078256845474,
      "rmse_dx": 0.011067605577409267,
      "rmse_dy": 0.009469318203628063,
      "rmse_mean": 0.0173450019210577,
      "rotation_flip": 0.0037282519042491913,
      "sparse_tokens": 32169.0,
      "step": 11549,
      "turn_loss": 0.2008257955312729,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29431.0,
      "epoch": 0.5366102954841108,
      "grad_norm": 0.3241371512413025,
      "learning_rate": 3.551772283745536e-08,
      "loss": 0.1019,
      "mae_dtheta": 0.023268431425094604,
      "mae_dx": 0.009713654406368732,
      "mae_dy": 0.0032387939281761646,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.32413727045059204,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.17471313476562,
      "model/head/act_norm_mean": 116.85150884271978,
      "model/head/act_norm_min": 65.75909423828125,
      "model/head/act_over_embed": 80.30145085777878,
      "model/head/grad_frac": 0.11976995319128036,
      "model/head/grad_norm": 0.038821905851364136,
      "model/head/grad_zero_frac": 0.00021066845511086285,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7023416037087912,
      "model/head/update_ratio": 0.0006608555559068918,
      "model/head/weight_delta": 9.985745429992676,
      "model/head/weight_delta_rel": 0.17517955601215363,
      "model/head/weight_norm": 58.74491882324219,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4228689670562744,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228689670562744,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228689670562744,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905995131227158,
      "model/modality_embedder.encoders.pose/grad_frac": 0.060243941843509674,
      "model/modality_embedder.encoders.pose/grad_norm": 0.019527306780219078,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.000630526221357286,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1568901538848877,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314544290304184,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969858169555664,
      "model/modality_embedder/grad_frac": 0.060243941843509674,
      "model/modality_embedder/grad_norm": 0.019527306780219078,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.000630526221357286,
      "model/modality_embedder/weight_delta": 3.1568901538848877,
      "model/modality_embedder/weight_delta_rel": 0.10314544290304184,
      "model/modality_embedder/weight_norm": 30.969858169555664,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.97173309326172,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.213784231641373,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.116484642028809,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.639939217003533,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07377098500728607,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02391192503273487,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002975710085593164,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008551813662052155,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.742708921432495,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09994596987962723,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961233139038086,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.22210693359375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.98220009157509,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.559694290161133,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.16800178997261,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07141540944576263,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.023148396983742714,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007775507983751595,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4774181842803955,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12046048045158386,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770912170410156,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.8440933227539,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.569196428571427,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.668622970581055,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.258600530450288,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06952151656150818,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02253451570868492,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007330088992603123,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.767378091812134,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12650150060653687,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.74248504638672,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.63319396972656,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.33687641723356,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.878870010375977,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.473366767939698,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07325157523155212,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.023743566125631332,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0007926211692392826,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2384707927703857,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11067556589841843,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95575523376465,
      "model/normalizer/grad_frac": 0.2500210404396057,
      "model/normalizer/grad_norm": 0.0810411348938942,
      "model/normalizer/grad_zero_frac": 0.00027770851738750935,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010302963200956583,
      "model/normalizer/weight_delta": 6.810348033905029,
      "model/normalizer/weight_delta_rel": 0.0877133384346962,
      "model/normalizer/weight_norm": 78.6580810546875,
      "pose_mae_dtheta": 0.17542974650859833,
      "pose_mae_dx": 0.07853452861309052,
      "pose_mae_dy": 0.0486900769174099,
      "pose_rmse_dtheta": 0.3663795292377472,
      "pose_rmse_dx": 0.1934676468372345,
      "pose_rmse_dy": 0.12352458387613297,
      "pose_rmse_mean": 0.22779059410095215,
      "rmse_dtheta": 0.04161745682358742,
      "rmse_dx": 0.022467928007245064,
      "rmse_dy": 0.006708204280585051,
      "rmse_mean": 0.02359786443412304,
      "rotation_flip": 0.006036217324435711,
      "sparse_tokens": 22677.0,
      "step": 11550,
      "turn_loss": 0.19522488117218018,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 34606.0,
      "epoch": 0.5366567552499535,
      "grad_norm": 0.6420226097106934,
      "learning_rate": 3.536057663355852e-08,
      "loss": 0.201,
      "mae_dtheta": 0.03546352684497833,
      "mae_dx": 0.012752069160342216,
      "mae_dy": 0.005952914245426655,
      "pose_mae_dtheta": 0.30909597873687744,
      "pose_mae_dx": 0.10256766527891159,
      "pose_mae_dy": 0.06236385554075241,
      "pose_rmse_dtheta": 0.5082480311393738,
      "pose_rmse_dx": 0.2226821929216385,
      "pose_rmse_dy": 0.14718157052993774,
      "pose_rmse_mean": 0.29270392656326294,
      "rmse_dtheta": 0.052049797028303146,
      "rmse_dx": 0.025070112198591232,
      "rmse_dy": 0.012347172945737839,
      "rmse_mean": 0.02982236072421074,
      "rotation_flip": 0.016225961968302727,
      "sparse_tokens": 27273.0,
      "step": 11551,
      "turn_loss": 0.3304191529750824,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.5367032150157963,
      "grad_norm": 0.5441910028457642,
      "learning_rate": 3.5203777609561504e-08,
      "loss": 0.1166,
      "mae_dtheta": 0.042008109390735626,
      "mae_dx": 0.011208891868591309,
      "mae_dy": 0.0042360695078969,
      "pose_mae_dtheta": 0.3361422121524811,
      "pose_mae_dx": 0.07087179273366928,
      "pose_mae_dy": 0.06287776678800583,
      "pose_rmse_dtheta": 0.5953787565231323,
      "pose_rmse_dx": 0.18485642969608307,
      "pose_rmse_dy": 0.1839035302400589,
      "pose_rmse_mean": 0.32137957215309143,
      "rmse_dtheta": 0.06360363960266113,
      "rmse_dx": 0.024016233161091805,
      "rmse_dy": 0.01101513858884573,
      "rmse_mean": 0.032878339290618896,
      "rotation_flip": 0.014028056524693966,
      "sparse_tokens": 7335.0,
      "step": 11552,
      "turn_loss": 0.2513888478279114,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 18506.0,
      "epoch": 0.5367496747816392,
      "grad_norm": 0.8823623061180115,
      "learning_rate": 3.5047325776428884e-08,
      "loss": 0.2059,
      "mae_dtheta": 0.03467993065714836,
      "mae_dx": 0.008330406621098518,
      "mae_dy": 0.0033230448607355356,
      "pose_mae_dtheta": 0.27622318267822266,
      "pose_mae_dx": 0.06221793591976166,
      "pose_mae_dy": 0.037439391016960144,
      "pose_rmse_dtheta": 0.5127503871917725,
      "pose_rmse_dx": 0.1380014568567276,
      "pose_rmse_dy": 0.09386680275201797,
      "pose_rmse_mean": 0.248206228017807,
      "rmse_dtheta": 0.05512428656220436,
      "rmse_dx": 0.018646232783794403,
      "rmse_dy": 0.006617207545787096,
      "rmse_mean": 0.02679591253399849,
      "rotation_flip": 0.011025357991456985,
      "sparse_tokens": 14051.0,
      "step": 11553,
      "turn_loss": 0.24086996912956238,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 36664.0,
      "epoch": 0.5367961345474819,
      "grad_norm": 0.5058634281158447,
      "learning_rate": 3.489122114510135e-08,
      "loss": 0.143,
      "mae_dtheta": 0.03740955889225006,
      "mae_dx": 0.00934029184281826,
      "mae_dy": 0.004228548612445593,
      "pose_mae_dtheta": 0.2847317159175873,
      "pose_mae_dx": 0.07593179494142532,
      "pose_mae_dy": 0.04153561592102051,
      "pose_rmse_dtheta": 0.48690295219421387,
      "pose_rmse_dx": 0.1669134795665741,
      "pose_rmse_dy": 0.10939287394285202,
      "pose_rmse_mean": 0.25440311431884766,
      "rmse_dtheta": 0.05676162242889404,
      "rmse_dx": 0.01947745680809021,
      "rmse_dy": 0.009588975459337234,
      "rmse_mean": 0.028609350323677063,
      "rotation_flip": 0.013616558164358139,
      "sparse_tokens": 29764.0,
      "step": 11554,
      "turn_loss": 0.27920955419540405,
      "turns": 113.0,
      "turns_per_sample": 113.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5368425943133247,
      "grad_norm": 0.32806265354156494,
      "learning_rate": 3.4735463726495724e-08,
      "loss": 0.0688,
      "mae_dtheta": 0.004416858311742544,
      "mae_dx": 0.0020300811156630516,
      "mae_dy": 0.000561949738766998,
      "pose_mae_dtheta": 0.029958542436361313,
      "pose_mae_dx": 0.01917595975100994,
      "pose_mae_dy": 0.00736841419711709,
      "pose_rmse_dtheta": 0.10864293575286865,
      "pose_rmse_dx": 0.07115533202886581,
      "pose_rmse_dy": 0.028202831745147705,
      "pose_rmse_mean": 0.06933370232582092,
      "rmse_dtheta": 0.016746079549193382,
      "rmse_dx": 0.00737422751262784,
      "rmse_dy": 0.0020249139051884413,
      "rmse_mean": 0.008715073578059673,
      "rotation_flip": 0.002926829271018505,
      "sparse_tokens": 32073.0,
      "step": 11555,
      "turn_loss": 0.0472426600754261,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5368890540791674,
      "grad_norm": 0.5074177980422974,
      "learning_rate": 3.4580053531504396e-08,
      "loss": 0.137,
      "mae_dtheta": 0.008919182233512402,
      "mae_dx": 0.0012731112074106932,
      "mae_dy": 0.0020705012138932943,
      "pose_mae_dtheta": 0.05762920528650284,
      "pose_mae_dx": 0.018337279558181763,
      "pose_mae_dy": 0.025235984474420547,
      "pose_rmse_dtheta": 0.1631232053041458,
      "pose_rmse_dx": 0.04862618073821068,
      "pose_rmse_dy": 0.05836533382534981,
      "pose_rmse_mean": 0.0900382399559021,
      "rmse_dtheta": 0.02197270654141903,
      "rmse_dx": 0.004034077748656273,
      "rmse_dy": 0.004856056999415159,
      "rmse_mean": 0.010287614539265633,
      "rotation_flip": 0.0030120480805635452,
      "sparse_tokens": 32057.0,
      "step": 11556,
      "turn_loss": 0.06981633603572845,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5369355138450103,
      "grad_norm": 0.5239565968513489,
      "learning_rate": 3.44249905709948e-08,
      "loss": 0.1459,
      "mae_dtheta": 0.010753520764410496,
      "mae_dx": 0.0019592931494116783,
      "mae_dy": 0.0037206111010164022,
      "pose_mae_dtheta": 0.0775589644908905,
      "pose_mae_dx": 0.030437743291258812,
      "pose_mae_dy": 0.03076801262795925,
      "pose_rmse_dtheta": 0.198591411113739,
      "pose_rmse_dx": 0.08692068606615067,
      "pose_rmse_dy": 0.06732944399118423,
      "pose_rmse_mean": 0.11761384457349777,
      "rmse_dtheta": 0.023625101894140244,
      "rmse_dx": 0.0056208036839962006,
      "rmse_dy": 0.00823395885527134,
      "rmse_mean": 0.012493288144469261,
      "rotation_flip": 0.0023121386766433716,
      "sparse_tokens": 32057.0,
      "step": 11557,
      "turn_loss": 0.10085280239582062,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.536981973610853,
      "grad_norm": 0.41957151889801025,
      "learning_rate": 3.4270274855811024e-08,
      "loss": 0.1037,
      "mae_dtheta": 0.04189673066139221,
      "mae_dx": 0.008710351772606373,
      "mae_dy": 0.0025432209949940443,
      "pose_mae_dtheta": 0.3226194381713867,
      "pose_mae_dx": 0.06557784974575043,
      "pose_mae_dy": 0.0382876992225647,
      "pose_rmse_dtheta": 0.6111118793487549,
      "pose_rmse_dx": 0.1628578156232834,
      "pose_rmse_dy": 0.09665631502866745,
      "pose_rmse_mean": 0.29020869731903076,
      "rmse_dtheta": 0.06468106061220169,
      "rmse_dx": 0.020162705332040787,
      "rmse_dy": 0.005145356524735689,
      "rmse_mean": 0.029996376484632492,
      "rotation_flip": 0.01337792631238699,
      "sparse_tokens": 10187.0,
      "step": 11558,
      "turn_loss": 0.2424216866493225,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.5370284333766958,
      "grad_norm": 0.8965889811515808,
      "learning_rate": 3.4115906396772205e-08,
      "loss": 0.25,
      "mae_dtheta": 0.029577255249023438,
      "mae_dx": 0.008370710536837578,
      "mae_dy": 0.007093055173754692,
      "pose_mae_dtheta": 0.21073168516159058,
      "pose_mae_dx": 0.06659059226512909,
      "pose_mae_dy": 0.0854150652885437,
      "pose_rmse_dtheta": 0.41329240798950195,
      "pose_rmse_dx": 0.1774640828371048,
      "pose_rmse_dy": 0.2003607153892517,
      "pose_rmse_mean": 0.2637057304382324,
      "rmse_dtheta": 0.04892265796661377,
      "rmse_dx": 0.01973661221563816,
      "rmse_dy": 0.01658860221505165,
      "rmse_mean": 0.02841595932841301,
      "rotation_flip": 0.020969856530427933,
      "sparse_tokens": 13315.0,
      "step": 11559,
      "turn_loss": 0.2437538355588913,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5370748931425385,
      "grad_norm": 0.46706944704055786,
      "learning_rate": 3.396188520467303e-08,
      "loss": 0.1323,
      "mae_dtheta": 0.0074788727797567844,
      "mae_dx": 0.0011320211924612522,
      "mae_dy": 0.0017115914961323142,
      "pose_mae_dtheta": 0.04184311255812645,
      "pose_mae_dx": 0.014892803505063057,
      "pose_mae_dy": 0.02037464641034603,
      "pose_rmse_dtheta": 0.07403730601072311,
      "pose_rmse_dx": 0.03188082203269005,
      "pose_rmse_dy": 0.04358740895986557,
      "pose_rmse_mean": 0.04983517527580261,
      "rmse_dtheta": 0.014540069736540318,
      "rmse_dx": 0.0031326988246291876,
      "rmse_dy": 0.0034120799973607063,
      "rmse_mean": 0.0070282830856740475,
      "rotation_flip": 0.005250262562185526,
      "sparse_tokens": 32137.0,
      "step": 11560,
      "turn_loss": 0.0659029632806778,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5371213529083814,
      "grad_norm": 0.44773051142692566,
      "learning_rate": 3.3808211290284886e-08,
      "loss": 0.1139,
      "mae_dtheta": 0.007498181425035,
      "mae_dx": 0.0012865265598520637,
      "mae_dy": 0.000983932870440185,
      "pose_mae_dtheta": 0.0503275990486145,
      "pose_mae_dx": 0.01286837738007307,
      "pose_mae_dy": 0.01402401365339756,
      "pose_rmse_dtheta": 0.13637734949588776,
      "pose_rmse_dx": 0.028640732169151306,
      "pose_rmse_dy": 0.032981861382722855,
      "pose_rmse_mean": 0.06599998474121094,
      "rmse_dtheta": 0.01882633939385414,
      "rmse_dx": 0.0036614956334233284,
      "rmse_dy": 0.00204484723508358,
      "rmse_mean": 0.00817756075412035,
      "rotation_flip": 0.0014251781394705176,
      "sparse_tokens": 32137.0,
      "step": 11561,
      "turn_loss": 0.05597816780209541,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.5371678126742241,
      "grad_norm": 1.3473700284957886,
      "learning_rate": 3.365488466435418e-08,
      "loss": 0.2371,
      "mae_dtheta": 0.03304504230618477,
      "mae_dx": 0.016912484541535378,
      "mae_dy": 0.005692013073712587,
      "pose_mae_dtheta": 0.2555868923664093,
      "pose_mae_dx": 0.1523708999156952,
      "pose_mae_dy": 0.07277156412601471,
      "pose_rmse_dtheta": 0.45789143443107605,
      "pose_rmse_dx": 0.3364507257938385,
      "pose_rmse_dy": 0.15517167747020721,
      "pose_rmse_mean": 0.3165046274662018,
      "rmse_dtheta": 0.04896704852581024,
      "rmse_dx": 0.03288860246539116,
      "rmse_dy": 0.009667804464697838,
      "rmse_mean": 0.030507821589708328,
      "rotation_flip": 0.021008403971791267,
      "sparse_tokens": 10509.0,
      "step": 11562,
      "turn_loss": 0.28176674246788025,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5372142724400669,
      "grad_norm": 0.40875044465065,
      "learning_rate": 3.350190533760289e-08,
      "loss": 0.0753,
      "mae_dtheta": 0.006977168843150139,
      "mae_dx": 0.0015834589721634984,
      "mae_dy": 0.0012853082735091448,
      "pose_mae_dtheta": 0.049771882593631744,
      "pose_mae_dx": 0.016063518822193146,
      "pose_mae_dy": 0.018526451662182808,
      "pose_rmse_dtheta": 0.11362987011671066,
      "pose_rmse_dx": 0.03765970468521118,
      "pose_rmse_dy": 0.04272767901420593,
      "pose_rmse_mean": 0.06467242538928986,
      "rmse_dtheta": 0.015664054080843925,
      "rmse_dx": 0.00500825047492981,
      "rmse_dy": 0.0026001876685768366,
      "rmse_mean": 0.007757497485727072,
      "rotation_flip": 0.005838198587298393,
      "sparse_tokens": 32137.0,
      "step": 11563,
      "turn_loss": 0.06076500564813614,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5372607322059096,
      "grad_norm": 0.583118736743927,
      "learning_rate": 3.3349273320729125e-08,
      "loss": 0.1196,
      "mae_dtheta": 0.00933624804019928,
      "mae_dx": 0.0013246984453871846,
      "mae_dy": 0.0018525971099734306,
      "pose_mae_dtheta": 0.05855301767587662,
      "pose_mae_dx": 0.015811720862984657,
      "pose_mae_dy": 0.022837847471237183,
      "pose_rmse_dtheta": 0.15362666547298431,
      "pose_rmse_dx": 0.04341985657811165,
      "pose_rmse_dy": 0.0512668751180172,
      "pose_rmse_mean": 0.08277113735675812,
      "rmse_dtheta": 0.019990170374512672,
      "rmse_dx": 0.0046416944824159145,
      "rmse_dy": 0.00410988787189126,
      "rmse_mean": 0.009580584242939949,
      "rotation_flip": 0.0039093042723834515,
      "sparse_tokens": 32073.0,
      "step": 11564,
      "turn_loss": 0.06361260265111923,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5373071919717525,
      "grad_norm": 0.4409516453742981,
      "learning_rate": 3.319698862440657e-08,
      "loss": 0.1015,
      "mae_dtheta": 0.008091111667454243,
      "mae_dx": 0.0016592995962128043,
      "mae_dy": 0.0020982534624636173,
      "pose_mae_dtheta": 0.05403504893183708,
      "pose_mae_dx": 0.016631966456770897,
      "pose_mae_dy": 0.01762840524315834,
      "pose_rmse_dtheta": 0.14945939183235168,
      "pose_rmse_dx": 0.048332326114177704,
      "pose_rmse_dy": 0.039978962391614914,
      "pose_rmse_mean": 0.07925689965486526,
      "rmse_dtheta": 0.02043170854449272,
      "rmse_dx": 0.0054770223796367645,
      "rmse_dy": 0.005960407201200724,
      "rmse_mean": 0.01062304712831974,
      "rotation_flip": 0.0036855037324130535,
      "sparse_tokens": 32121.0,
      "step": 11565,
      "turn_loss": 0.07228297740221024,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.5373536517375952,
      "grad_norm": 0.6330083608627319,
      "learning_rate": 3.304505125928392e-08,
      "loss": 0.1564,
      "mae_dtheta": 0.037016820162534714,
      "mae_dx": 0.011601433157920837,
      "mae_dy": 0.006915151607245207,
      "pose_mae_dtheta": 0.2824392020702362,
      "pose_mae_dx": 0.08830945938825607,
      "pose_mae_dy": 0.0769418254494667,
      "pose_rmse_dtheta": 0.46838292479515076,
      "pose_rmse_dx": 0.18626919388771057,
      "pose_rmse_dy": 0.16602738201618195,
      "pose_rmse_mean": 0.2735598385334015,
      "rmse_dtheta": 0.054677221924066544,
      "rmse_dx": 0.023448435589671135,
      "rmse_dy": 0.013438587076961994,
      "rmse_mean": 0.030521415174007416,
      "rotation_flip": 0.01652892492711544,
      "sparse_tokens": 14162.0,
      "step": 11566,
      "turn_loss": 0.298718124628067,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.537400111503438,
      "grad_norm": 0.38668525218963623,
      "learning_rate": 3.289346123598769e-08,
      "loss": 0.1146,
      "mae_dtheta": 0.011781980283558369,
      "mae_dx": 0.0026195074897259474,
      "mae_dy": 0.0032220021821558475,
      "pose_mae_dtheta": 0.07374861091375351,
      "pose_mae_dx": 0.028295336291193962,
      "pose_mae_dy": 0.03305640444159508,
      "pose_rmse_dtheta": 0.17124703526496887,
      "pose_rmse_dx": 0.0884881317615509,
      "pose_rmse_dy": 0.07922369986772537,
      "pose_rmse_mean": 0.11298628896474838,
      "rmse_dtheta": 0.02460681088268757,
      "rmse_dx": 0.008719250559806824,
      "rmse_dy": 0.007845941931009293,
      "rmse_mean": 0.013724001124501228,
      "rotation_flip": 0.0058139534667134285,
      "sparse_tokens": 32057.0,
      "step": 11567,
      "turn_loss": 0.1208060160279274,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5374465712692807,
      "grad_norm": 0.4812040627002716,
      "learning_rate": 3.274221856511661e-08,
      "loss": 0.0887,
      "mae_dtheta": 0.005810121539980173,
      "mae_dx": 0.0016277144895866513,
      "mae_dy": 0.0006558505119755864,
      "pose_mae_dtheta": 0.04139035940170288,
      "pose_mae_dx": 0.013162289746105671,
      "pose_mae_dy": 0.009392399340867996,
      "pose_rmse_dtheta": 0.1648932844400406,
      "pose_rmse_dx": 0.04554055631160736,
      "pose_rmse_dy": 0.024817753583192825,
      "pose_rmse_mean": 0.07841719686985016,
      "rmse_dtheta": 0.019203511998057365,
      "rmse_dx": 0.0062490287236869335,
      "rmse_dy": 0.001630157115869224,
      "rmse_mean": 0.009027566760778427,
      "rotation_flip": 0.008787346072494984,
      "sparse_tokens": 32073.0,
      "step": 11568,
      "turn_loss": 0.0476158931851387,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.5374930310351236,
      "grad_norm": 0.6523401737213135,
      "learning_rate": 3.25913232572489e-08,
      "loss": 0.123,
      "mae_dtheta": 0.0403670072555542,
      "mae_dx": 0.01338778343051672,
      "mae_dy": 0.003674055216833949,
      "pose_mae_dtheta": 0.30496081709861755,
      "pose_mae_dx": 0.1169290542602539,
      "pose_mae_dy": 0.060342155396938324,
      "pose_rmse_dtheta": 0.5180227756500244,
      "pose_rmse_dx": 0.2659580111503601,
      "pose_rmse_dy": 0.15114706754684448,
      "pose_rmse_mean": 0.31170928478240967,
      "rmse_dtheta": 0.060605477541685104,
      "rmse_dx": 0.026880411431193352,
      "rmse_dy": 0.007736819330602884,
      "rmse_mean": 0.03174090385437012,
      "rotation_flip": 0.008097166195511818,
      "sparse_tokens": 4357.0,
      "step": 11569,
      "turn_loss": 0.26218146085739136,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5375394908009664,
      "grad_norm": 0.477542519569397,
      "learning_rate": 3.24407753229361e-08,
      "loss": 0.0869,
      "mae_dtheta": 0.006991129834204912,
      "mae_dx": 0.0016753899399191141,
      "mae_dy": 0.002117301570251584,
      "pose_mae_dtheta": 0.0486123226583004,
      "pose_mae_dx": 0.019001130014657974,
      "pose_mae_dy": 0.02388938143849373,
      "pose_rmse_dtheta": 0.11339230835437775,
      "pose_rmse_dx": 0.06419682502746582,
      "pose_rmse_dy": 0.08275039494037628,
      "pose_rmse_mean": 0.08677984774112701,
      "rmse_dtheta": 0.016453592106699944,
      "rmse_dx": 0.006113121286034584,
      "rmse_dy": 0.006336613092571497,
      "rmse_mean": 0.009634442627429962,
      "rotation_flip": 0.006535947788506746,
      "sparse_tokens": 32105.0,
      "step": 11570,
      "turn_loss": 0.0780770480632782,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5375859505668091,
      "grad_norm": 0.5116474032402039,
      "learning_rate": 3.229057477270647e-08,
      "loss": 0.0765,
      "mae_dtheta": 0.007646807469427586,
      "mae_dx": 0.0016816946445032954,
      "mae_dy": 0.0010353343095630407,
      "pose_mae_dtheta": 0.055666860193014145,
      "pose_mae_dx": 0.017335262149572372,
      "pose_mae_dy": 0.012463082559406757,
      "pose_rmse_dtheta": 0.17640313506126404,
      "pose_rmse_dx": 0.05036289244890213,
      "pose_rmse_dy": 0.03705660253763199,
      "pose_rmse_mean": 0.08794087171554565,
      "rmse_dtheta": 0.02073322795331478,
      "rmse_dx": 0.005483993794769049,
      "rmse_dy": 0.0027191024273633957,
      "rmse_mean": 0.009645441547036171,
      "rotation_flip": 0.004768717102706432,
      "sparse_tokens": 32185.0,
      "step": 11571,
      "turn_loss": 0.05677758902311325,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.537632410332652,
      "grad_norm": 0.29714205861091614,
      "learning_rate": 3.214072161706272e-08,
      "loss": 0.0796,
      "mae_dtheta": 0.009163041599094868,
      "mae_dx": 0.0016379189910367131,
      "mae_dy": 0.0026407770346850157,
      "pose_mae_dtheta": 0.06136002391576767,
      "pose_mae_dx": 0.02181413397192955,
      "pose_mae_dy": 0.02552781254053116,
      "pose_rmse_dtheta": 0.12679600715637207,
      "pose_rmse_dx": 0.05703658238053322,
      "pose_rmse_dy": 0.05670689046382904,
      "pose_rmse_mean": 0.08017982542514801,
      "rmse_dtheta": 0.018453553318977356,
      "rmse_dx": 0.004739690572023392,
      "rmse_dy": 0.006132929120212793,
      "rmse_mean": 0.009775390848517418,
      "rotation_flip": 0.001336451736278832,
      "sparse_tokens": 32137.0,
      "step": 11572,
      "turn_loss": 0.08782913535833359,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.5376788700984947,
      "grad_norm": 0.4037992060184479,
      "learning_rate": 3.199121586648479e-08,
      "loss": 0.1029,
      "mae_dtheta": 0.030466247349977493,
      "mae_dx": 0.010264304466545582,
      "mae_dy": 0.004372033290565014,
      "pose_mae_dtheta": 0.21557888388633728,
      "pose_mae_dx": 0.08095607906579971,
      "pose_mae_dy": 0.048289161175489426,
      "pose_rmse_dtheta": 0.41002169251441956,
      "pose_rmse_dx": 0.18081912398338318,
      "pose_rmse_dy": 0.10964242368936539,
      "pose_rmse_mean": 0.23349443078041077,
      "rmse_dtheta": 0.04929941147565842,
      "rmse_dx": 0.02124902792274952,
      "rmse_dy": 0.009825051762163639,
      "rmse_mean": 0.02679116278886795,
      "rotation_flip": 0.011278195306658745,
      "sparse_tokens": 11640.0,
      "step": 11573,
      "turn_loss": 0.26240020990371704,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5377253298643375,
      "grad_norm": 0.3201662302017212,
      "learning_rate": 3.184205753142766e-08,
      "loss": 0.0752,
      "mae_dtheta": 0.009359097108244896,
      "mae_dx": 0.0008936331141740084,
      "mae_dy": 0.002295003505423665,
      "pose_mae_dtheta": 0.057207297533750534,
      "pose_mae_dx": 0.014348690398037434,
      "pose_mae_dy": 0.026057373732328415,
      "pose_rmse_dtheta": 0.1318431794643402,
      "pose_rmse_dx": 0.038186751306056976,
      "pose_rmse_dy": 0.05843668431043625,
      "pose_rmse_mean": 0.07615554332733154,
      "rmse_dtheta": 0.019948085770010948,
      "rmse_dx": 0.0027324033435434103,
      "rmse_dy": 0.004710928536951542,
      "rmse_mean": 0.009130473248660564,
      "rotation_flip": 0.004913076292723417,
      "sparse_tokens": 32041.0,
      "step": 11574,
      "turn_loss": 0.07269617170095444,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5377717896301802,
      "grad_norm": 0.5203516483306885,
      "learning_rate": 3.169324662232187e-08,
      "loss": 0.1419,
      "mae_dtheta": 0.007849291898310184,
      "mae_dx": 0.0010717656696215272,
      "mae_dy": 0.0009414586238563061,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5203517079353333,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 167.60601806640625,
      "model/head/act_norm_mean": 126.40449416035354,
      "model/head/act_norm_min": 60.99623107910156,
      "model/head/act_over_embed": 86.86635180451432,
      "model/head/grad_frac": 0.10284173488616943,
      "model/head/grad_norm": 0.05351387336850166,
      "model/head/grad_zero_frac": 0.00020686119387391955,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7012162642045454,
      "model/head/update_ratio": 0.0009109530365094543,
      "model/head/weight_delta": 9.98581314086914,
      "model/head/weight_delta_rel": 0.17518073320388794,
      "model/head/weight_norm": 58.744930267333984,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229286313056946,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42286979019372173,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228042960166931,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29060007879047595,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08833925426006317,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04596748203039169,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5431189903846154,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0014842653181403875,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569161415100098,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314629226922989,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96985626220703,
      "model/modality_embedder/grad_frac": 0.08833925426006317,
      "model/modality_embedder/grad_norm": 0.04596748203039169,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5431189903846154,
      "model/modality_embedder/update_ratio": 0.0014842653181403875,
      "model/modality_embedder/weight_delta": 3.1569161415100098,
      "model/modality_embedder/weight_delta_rel": 0.10314629226922989,
      "model/modality_embedder/weight_norm": 30.96985626220703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 94.48505401611328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 25.173703803912137,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.94371223449707,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 17.29960493397663,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05455110967159271,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.028385762125253677,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00029252743115648627,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010151827009394765,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.742741346359253,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09994714707136154,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96123504638672,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 96.34579467773438,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 26.158860429693764,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.147143363952637,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.976613790395408,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.055404182523489,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.028829660266637802,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00035305035999044776,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009683829848654568,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4774701595306396,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12046228349208832,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77092742919922,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 98.36711120605469,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.970513668430335,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.22607707977295,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 19.221598857020027,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.04969452694058418,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02585863135755062,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002723531215451658,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008411360322497785,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.767436981201172,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12650348246097565,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742507934570312,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 98.9416732788086,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.60081970498637,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.04259204864502,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 20.341960428506923,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.048310987651348114,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.025138704106211662,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0008391942828893661,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2385144233703613,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11067705601453781,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955760955810547,
      "model/normalizer/grad_frac": 0.1752559095621109,
      "model/normalizer/grad_norm": 0.09119471162557602,
      "model/normalizer/grad_zero_frac": 0.00030134330154396594,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0011593811213970184,
      "model/normalizer/weight_delta": 6.8104448318481445,
      "model/normalizer/weight_delta_rel": 0.08771458268165588,
      "model/normalizer/weight_norm": 78.65809631347656,
      "pose_mae_dtheta": 0.056382596492767334,
      "pose_mae_dx": 0.012513632886111736,
      "pose_mae_dy": 0.01326647400856018,
      "pose_rmse_dtheta": 0.2309562712907791,
      "pose_rmse_dx": 0.03926393762230873,
      "pose_rmse_dy": 0.04483756050467491,
      "pose_rmse_mean": 0.10501926392316818,
      "rmse_dtheta": 0.02548336051404476,
      "rmse_dx": 0.0036204280331730843,
      "rmse_dy": 0.002790855010971427,
      "rmse_mean": 0.01063154824078083,
      "rotation_flip": 0.0022805016487836838,
      "sparse_tokens": 32089.0,
      "step": 11575,
      "turn_loss": 0.04913683235645294,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5378182493960231,
      "grad_norm": 0.35717013478279114,
      "learning_rate": 3.154478314957465e-08,
      "loss": 0.0646,
      "mae_dtheta": 0.007981698028743267,
      "mae_dx": 0.001101980684325099,
      "mae_dy": 0.002124160062521696,
      "pose_mae_dtheta": 0.049590613692998886,
      "pose_mae_dx": 0.01944662816822529,
      "pose_mae_dy": 0.024525534361600876,
      "pose_rmse_dtheta": 0.12013805657625198,
      "pose_rmse_dx": 0.04880516976118088,
      "pose_rmse_dy": 0.05399497225880623,
      "pose_rmse_mean": 0.0743127316236496,
      "rmse_dtheta": 0.016764340922236443,
      "rmse_dx": 0.002791772363707423,
      "rmse_dy": 0.004360691644251347,
      "rmse_mean": 0.007972268387675285,
      "rotation_flip": 0.0019815058913081884,
      "sparse_tokens": 32105.0,
      "step": 11576,
      "turn_loss": 0.06105457618832588,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26930.0,
      "epoch": 0.5378647091618658,
      "grad_norm": 1.0169453620910645,
      "learning_rate": 3.139666712356715e-08,
      "loss": 0.2609,
      "mae_dtheta": 0.026998726651072502,
      "mae_dx": 0.011472539976239204,
      "mae_dy": 0.005520048085600138,
      "pose_mae_dtheta": 0.20002691447734833,
      "pose_mae_dx": 0.10548160970211029,
      "pose_mae_dy": 0.07008916139602661,
      "pose_rmse_dtheta": 0.3597651422023773,
      "pose_rmse_dx": 0.257109135389328,
      "pose_rmse_dy": 0.16637413203716278,
      "pose_rmse_mean": 0.26108282804489136,
      "rmse_dtheta": 0.04453878104686737,
      "rmse_dx": 0.025667356327176094,
      "rmse_dy": 0.011351504363119602,
      "rmse_mean": 0.02718587964773178,
      "rotation_flip": 0.008417508564889431,
      "sparse_tokens": 22081.0,
      "step": 11577,
      "turn_loss": 0.23454874753952026,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5379111689277086,
      "grad_norm": 0.5743942856788635,
      "learning_rate": 3.124889855465718e-08,
      "loss": 0.1496,
      "mae_dtheta": 0.011679411865770817,
      "mae_dx": 0.0012057069689035416,
      "mae_dy": 0.0025165441911667585,
      "pose_mae_dtheta": 0.06773747503757477,
      "pose_mae_dx": 0.017282508313655853,
      "pose_mae_dy": 0.0307865459471941,
      "pose_rmse_dtheta": 0.14807268977165222,
      "pose_rmse_dx": 0.040668703615665436,
      "pose_rmse_dy": 0.06338485330343246,
      "pose_rmse_mean": 0.08404208719730377,
      "rmse_dtheta": 0.022265907377004623,
      "rmse_dx": 0.003700544126331806,
      "rmse_dy": 0.004941912833601236,
      "rmse_mean": 0.010302787646651268,
      "rotation_flip": 0.0019212295301258564,
      "sparse_tokens": 32089.0,
      "step": 11578,
      "turn_loss": 0.08768396824598312,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.5379576286935513,
      "grad_norm": 0.5416240096092224,
      "learning_rate": 3.1101477453178705e-08,
      "loss": 0.1318,
      "mae_dtheta": 0.0313277542591095,
      "mae_dx": 0.010358987376093864,
      "mae_dy": 0.004402871709316969,
      "pose_mae_dtheta": 0.25435954332351685,
      "pose_mae_dx": 0.08523483574390411,
      "pose_mae_dy": 0.055685922503471375,
      "pose_rmse_dtheta": 0.48407989740371704,
      "pose_rmse_dx": 0.20016486942768097,
      "pose_rmse_dy": 0.1323651373386383,
      "pose_rmse_mean": 0.2722032964229584,
      "rmse_dtheta": 0.051115795969963074,
      "rmse_dx": 0.023024043068289757,
      "rmse_dy": 0.009228826500475407,
      "rmse_mean": 0.027789555490016937,
      "rotation_flip": 0.01840490847826004,
      "sparse_tokens": 12590.0,
      "step": 11579,
      "turn_loss": 0.23712487518787384,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5380040884593942,
      "grad_norm": 0.34459859132766724,
      "learning_rate": 3.095440382944126e-08,
      "loss": 0.1071,
      "mae_dtheta": 0.00927648600190878,
      "mae_dx": 0.001642257790081203,
      "mae_dy": 0.0022488359827548265,
      "pose_mae_dtheta": 0.06473670899868011,
      "pose_mae_dx": 0.02030218206346035,
      "pose_mae_dy": 0.02704680524766445,
      "pose_rmse_dtheta": 0.16671067476272583,
      "pose_rmse_dx": 0.05432853102684021,
      "pose_rmse_dy": 0.06716284155845642,
      "pose_rmse_mean": 0.09606735408306122,
      "rmse_dtheta": 0.020898601040244102,
      "rmse_dx": 0.005464182235300541,
      "rmse_dy": 0.005024756770581007,
      "rmse_mean": 0.010462514124810696,
      "rotation_flip": 0.004004003945738077,
      "sparse_tokens": 32057.0,
      "step": 11580,
      "turn_loss": 0.07736709713935852,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5380505482252369,
      "grad_norm": 0.41093218326568604,
      "learning_rate": 3.080767769372939e-08,
      "loss": 0.0867,
      "mae_dtheta": 0.011667169630527496,
      "mae_dx": 0.0022181409876793623,
      "mae_dy": 0.002676066942512989,
      "pose_mae_dtheta": 0.084698885679245,
      "pose_mae_dx": 0.017896324396133423,
      "pose_mae_dy": 0.030835527926683426,
      "pose_rmse_dtheta": 0.21279659867286682,
      "pose_rmse_dx": 0.055105652660131454,
      "pose_rmse_dy": 0.08885237574577332,
      "pose_rmse_mean": 0.11891821026802063,
      "rmse_dtheta": 0.02688770182430744,
      "rmse_dx": 0.007655904162675142,
      "rmse_dy": 0.008281038142740726,
      "rmse_mean": 0.014274882152676582,
      "rotation_flip": 0.012001548893749714,
      "sparse_tokens": 32137.0,
      "step": 11581,
      "turn_loss": 0.10874461382627487,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5380970079910797,
      "grad_norm": 0.31430530548095703,
      "learning_rate": 3.066129905630322e-08,
      "loss": 0.0925,
      "mae_dtheta": 0.008604823611676693,
      "mae_dx": 0.0011395325418561697,
      "mae_dy": 0.0017136927926912904,
      "pose_mae_dtheta": 0.05860331654548645,
      "pose_mae_dx": 0.01508784107863903,
      "pose_mae_dy": 0.024641195312142372,
      "pose_rmse_dtheta": 0.12522929906845093,
      "pose_rmse_dx": 0.03955560177564621,
      "pose_rmse_dy": 0.05394689738750458,
      "pose_rmse_mean": 0.0729106068611145,
      "rmse_dtheta": 0.017988868057727814,
      "rmse_dx": 0.003729320364072919,
      "rmse_dy": 0.0035880845971405506,
      "rmse_mean": 0.008435424417257309,
      "rotation_flip": 0.0034338037949055433,
      "sparse_tokens": 32073.0,
      "step": 11582,
      "turn_loss": 0.06094640493392944,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5381434677569225,
      "grad_norm": 0.5304009914398193,
      "learning_rate": 3.0515267927400116e-08,
      "loss": 0.159,
      "mae_dtheta": 0.006501845084130764,
      "mae_dx": 0.001239763805642724,
      "mae_dy": 0.0017620400758460164,
      "pose_mae_dtheta": 0.03993576392531395,
      "pose_mae_dx": 0.012854956090450287,
      "pose_mae_dy": 0.015757637098431587,
      "pose_rmse_dtheta": 0.08373165130615234,
      "pose_rmse_dx": 0.030743412673473358,
      "pose_rmse_dy": 0.035786427557468414,
      "pose_rmse_mean": 0.05008716508746147,
      "rmse_dtheta": 0.013862389139831066,
      "rmse_dx": 0.0033984112087637186,
      "rmse_dy": 0.004638157784938812,
      "rmse_mean": 0.0072996532544493675,
      "rotation_flip": 0.0071146246045827866,
      "sparse_tokens": 32137.0,
      "step": 11583,
      "turn_loss": 0.05928828567266464,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5381899275227653,
      "grad_norm": 0.418003112077713,
      "learning_rate": 3.036958431723136e-08,
      "loss": 0.0865,
      "mae_dtheta": 0.008237097412347794,
      "mae_dx": 0.0015098745934665203,
      "mae_dy": 0.001899106428027153,
      "pose_mae_dtheta": 0.05339265242218971,
      "pose_mae_dx": 0.01943402923643589,
      "pose_mae_dy": 0.02191738411784172,
      "pose_rmse_dtheta": 0.12427514046430588,
      "pose_rmse_dx": 0.05944283679127693,
      "pose_rmse_dy": 0.059606149792671204,
      "pose_rmse_mean": 0.08110804855823517,
      "rmse_dtheta": 0.01755864918231964,
      "rmse_dx": 0.0050676302053034306,
      "rmse_dy": 0.004880144726485014,
      "rmse_mean": 0.009168808348476887,
      "rotation_flip": 0.003215434029698372,
      "sparse_tokens": 32105.0,
      "step": 11584,
      "turn_loss": 0.06511694937944412,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5382363872886081,
      "grad_norm": 0.38693201541900635,
      "learning_rate": 3.022424823598546e-08,
      "loss": 0.0614,
      "mae_dtheta": 0.00970905926078558,
      "mae_dx": 0.0014748875983059406,
      "mae_dy": 0.001965255243703723,
      "pose_mae_dtheta": 0.06132647022604942,
      "pose_mae_dx": 0.018865294754505157,
      "pose_mae_dy": 0.025971921160817146,
      "pose_rmse_dtheta": 0.14315472543239594,
      "pose_rmse_dx": 0.05230990797281265,
      "pose_rmse_dy": 0.0568242184817791,
      "pose_rmse_mean": 0.0840962827205658,
      "rmse_dtheta": 0.021555854007601738,
      "rmse_dx": 0.005035494454205036,
      "rmse_dy": 0.004045093897730112,
      "rmse_mean": 0.010212147608399391,
      "rotation_flip": 0.00890585221350193,
      "sparse_tokens": 32057.0,
      "step": 11585,
      "turn_loss": 0.0722016915678978,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.5382828470544508,
      "grad_norm": 0.3358162045478821,
      "learning_rate": 3.007925969382486e-08,
      "loss": 0.0778,
      "mae_dtheta": 0.03068852238357067,
      "mae_dx": 0.013061524368822575,
      "mae_dy": 0.010673128068447113,
      "pose_mae_dtheta": 0.22568880021572113,
      "pose_mae_dx": 0.10335657745599747,
      "pose_mae_dy": 0.10344889014959335,
      "pose_rmse_dtheta": 0.3825148344039917,
      "pose_rmse_dx": 0.2388634830713272,
      "pose_rmse_dy": 0.25449877977371216,
      "pose_rmse_mean": 0.2919590473175049,
      "rmse_dtheta": 0.04639260098338127,
      "rmse_dx": 0.02592010237276554,
      "rmse_dy": 0.023998023942112923,
      "rmse_mean": 0.03210357576608658,
      "rotation_flip": 0.009118541143834591,
      "sparse_tokens": 7794.0,
      "step": 11586,
      "turn_loss": 0.3221823573112488,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 3268.0,
      "epoch": 0.5383293068202937,
      "grad_norm": 0.41731733083724976,
      "learning_rate": 2.9934618700889205e-08,
      "loss": 0.0981,
      "mae_dtheta": 0.03647274151444435,
      "mae_dx": 0.020815065130591393,
      "mae_dy": 0.00812462903559208,
      "pose_mae_dtheta": 0.2372289001941681,
      "pose_mae_dx": 0.12062707543373108,
      "pose_mae_dy": 0.11772623658180237,
      "pose_rmse_dtheta": 0.3071567416191101,
      "pose_rmse_dx": 0.22598569095134735,
      "pose_rmse_dy": 0.2043222337961197,
      "pose_rmse_mean": 0.24582156538963318,
      "rmse_dtheta": 0.04834485426545143,
      "rmse_dx": 0.03334660828113556,
      "rmse_dy": 0.01243104599416256,
      "rmse_mean": 0.03137417137622833,
      "rotation_flip": 0.028776979073882103,
      "sparse_tokens": 2949.0,
      "step": 11587,
      "turn_loss": 0.40957221388816833,
      "turns": 10.0,
      "turns_per_sample": 10.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.5383757665861364,
      "grad_norm": 0.5366337895393372,
      "learning_rate": 2.9790325267293196e-08,
      "loss": 0.1095,
      "mae_dtheta": 0.030694592744112015,
      "mae_dx": 0.010072129778563976,
      "mae_dy": 0.006064616609364748,
      "pose_mae_dtheta": 0.1954411119222641,
      "pose_mae_dx": 0.08148087561130524,
      "pose_mae_dy": 0.06919003278017044,
      "pose_rmse_dtheta": 0.3443117141723633,
      "pose_rmse_dx": 0.19628390669822693,
      "pose_rmse_dy": 0.15317490696907043,
      "pose_rmse_mean": 0.23125684261322021,
      "rmse_dtheta": 0.04716283455491066,
      "rmse_dx": 0.022650377824902534,
      "rmse_dy": 0.011441445909440517,
      "rmse_mean": 0.02708488702774048,
      "rotation_flip": 0.009708737954497337,
      "sparse_tokens": 17510.0,
      "step": 11588,
      "turn_loss": 0.2566010653972626,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5384222263519792,
      "grad_norm": 0.4718742072582245,
      "learning_rate": 2.9646379403127644e-08,
      "loss": 0.1083,
      "mae_dtheta": 0.008139710873365402,
      "mae_dx": 0.002171519212424755,
      "mae_dy": 0.002604901324957609,
      "pose_mae_dtheta": 0.05541491135954857,
      "pose_mae_dx": 0.02661929465830326,
      "pose_mae_dy": 0.02100820094347,
      "pose_rmse_dtheta": 0.13578897714614868,
      "pose_rmse_dx": 0.07605666667222977,
      "pose_rmse_dy": 0.05591481924057007,
      "pose_rmse_mean": 0.0892534852027893,
      "rmse_dtheta": 0.019233044236898422,
      "rmse_dx": 0.005441168788820505,
      "rmse_dy": 0.006335090845823288,
      "rmse_mean": 0.010336434468626976,
      "rotation_flip": 0.00242816680110991,
      "sparse_tokens": 32137.0,
      "step": 11589,
      "turn_loss": 0.07256482541561127,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33413.0,
      "epoch": 0.538468686117822,
      "grad_norm": 0.5318014621734619,
      "learning_rate": 2.950278111845839e-08,
      "loss": 0.1755,
      "mae_dtheta": 0.04085542634129524,
      "mae_dx": 0.00826359260827303,
      "mae_dy": 0.004079687874764204,
      "pose_mae_dtheta": 0.33908310532569885,
      "pose_mae_dx": 0.06652146577835083,
      "pose_mae_dy": 0.037072788923978806,
      "pose_rmse_dtheta": 0.5417758226394653,
      "pose_rmse_dx": 0.15232957899570465,
      "pose_rmse_dy": 0.13091552257537842,
      "pose_rmse_mean": 0.2750069797039032,
      "rmse_dtheta": 0.05907261371612549,
      "rmse_dx": 0.017832206562161446,
      "rmse_dy": 0.01186091173440218,
      "rmse_mean": 0.029588578268885612,
      "rotation_flip": 0.012835472822189331,
      "sparse_tokens": 21601.0,
      "step": 11590,
      "turn_loss": 0.31101396679878235,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.5385151458836648,
      "grad_norm": 0.6180554628372192,
      "learning_rate": 2.93595304233274e-08,
      "loss": 0.0854,
      "mae_dtheta": 0.030931901186704636,
      "mae_dx": 0.015970749780535698,
      "mae_dy": 0.0021297240164130926,
      "pose_mae_dtheta": 0.251158744096756,
      "pose_mae_dx": 0.1335548460483551,
      "pose_mae_dy": 0.025543121621012688,
      "pose_rmse_dtheta": 0.41590961813926697,
      "pose_rmse_dx": 0.26038113236427307,
      "pose_rmse_dy": 0.0629846528172493,
      "pose_rmse_mean": 0.24642513692378998,
      "rmse_dtheta": 0.04792485013604164,
      "rmse_dx": 0.028001245111227036,
      "rmse_dy": 0.004677217453718185,
      "rmse_mean": 0.02686777338385582,
      "rotation_flip": 0.010695187374949455,
      "sparse_tokens": 7412.0,
      "step": 11591,
      "turn_loss": 0.20881329476833344,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5385616056495075,
      "grad_norm": 0.45392686128616333,
      "learning_rate": 2.9216627327752768e-08,
      "loss": 0.1334,
      "mae_dtheta": 0.006923644337803125,
      "mae_dx": 0.0007350980886258185,
      "mae_dy": 0.0012021836591884494,
      "pose_mae_dtheta": 0.04555046558380127,
      "pose_mae_dx": 0.00874985009431839,
      "pose_mae_dy": 0.017911875620484352,
      "pose_rmse_dtheta": 0.14141370356082916,
      "pose_rmse_dx": 0.023768790066242218,
      "pose_rmse_dy": 0.04206625744700432,
      "pose_rmse_mean": 0.06908292323350906,
      "rmse_dtheta": 0.018323151394724846,
      "rmse_dx": 0.002427284838631749,
      "rmse_dy": 0.002564597176387906,
      "rmse_mean": 0.007771678268909454,
      "rotation_flip": 0.0009487665956839919,
      "sparse_tokens": 32073.0,
      "step": 11592,
      "turn_loss": 0.04449503868818283,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5386080654153503,
      "grad_norm": 0.5180526375770569,
      "learning_rate": 2.907407184172706e-08,
      "loss": 0.1248,
      "mae_dtheta": 0.0107517559081316,
      "mae_dx": 0.002069596666842699,
      "mae_dy": 0.002959005068987608,
      "pose_mae_dtheta": 0.06907215714454651,
      "pose_mae_dx": 0.02451237477362156,
      "pose_mae_dy": 0.025852767750620842,
      "pose_rmse_dtheta": 0.16284248232841492,
      "pose_rmse_dx": 0.0651029646396637,
      "pose_rmse_dy": 0.05967455729842186,
      "pose_rmse_mean": 0.09587334096431732,
      "rmse_dtheta": 0.02331376262009144,
      "rmse_dx": 0.0056683095172047615,
      "rmse_dy": 0.006994893308728933,
      "rmse_mean": 0.011992322281002998,
      "rotation_flip": 0.005729564465582371,
      "sparse_tokens": 32121.0,
      "step": 11593,
      "turn_loss": 0.1080612987279892,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5386545251811931,
      "grad_norm": 0.7255627512931824,
      "learning_rate": 2.8931863975218966e-08,
      "loss": 0.1408,
      "mae_dtheta": 0.008307942189276218,
      "mae_dx": 0.001578784198500216,
      "mae_dy": 0.0017321532359346747,
      "pose_mae_dtheta": 0.057507533580064774,
      "pose_mae_dx": 0.020588286221027374,
      "pose_mae_dy": 0.023051274940371513,
      "pose_rmse_dtheta": 0.13258042931556702,
      "pose_rmse_dx": 0.05101439356803894,
      "pose_rmse_dy": 0.061695750802755356,
      "pose_rmse_mean": 0.08176352828741074,
      "rmse_dtheta": 0.017372623085975647,
      "rmse_dx": 0.00486055389046669,
      "rmse_dy": 0.0038336683064699173,
      "rmse_mean": 0.008688949048519135,
      "rotation_flip": 0.0035928143188357353,
      "sparse_tokens": 32137.0,
      "step": 11594,
      "turn_loss": 0.0688982754945755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5387009849470359,
      "grad_norm": 0.5639877319335938,
      "learning_rate": 2.8790003738174975e-08,
      "loss": 0.1397,
      "mae_dtheta": 0.009632800705730915,
      "mae_dx": 0.0014347605174407363,
      "mae_dy": 0.0022086419630795717,
      "pose_mae_dtheta": 0.06341924518346786,
      "pose_mae_dx": 0.02132457122206688,
      "pose_mae_dy": 0.026469014585018158,
      "pose_rmse_dtheta": 0.14535723626613617,
      "pose_rmse_dx": 0.05862502008676529,
      "pose_rmse_dy": 0.06387576460838318,
      "pose_rmse_mean": 0.08928601443767548,
      "rmse_dtheta": 0.020764563232660294,
      "rmse_dx": 0.003956143278628588,
      "rmse_dy": 0.004827320110052824,
      "rmse_mean": 0.00984934251755476,
      "rotation_flip": 0.0019364833133295178,
      "sparse_tokens": 32105.0,
      "step": 11595,
      "turn_loss": 0.0786931961774826,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14295.0,
      "epoch": 0.5387474447128786,
      "grad_norm": 0.8134831786155701,
      "learning_rate": 2.8648491140513267e-08,
      "loss": 0.1224,
      "mae_dtheta": 0.02020665816962719,
      "mae_dx": 0.0053645409643650055,
      "mae_dy": 0.0030578947626054287,
      "pose_mae_dtheta": 0.14662209153175354,
      "pose_mae_dx": 0.05044068396091461,
      "pose_mae_dy": 0.04174412414431572,
      "pose_rmse_dtheta": 0.3382810056209564,
      "pose_rmse_dx": 0.1412242352962494,
      "pose_rmse_dy": 0.11430911719799042,
      "pose_rmse_mean": 0.19793812930583954,
      "rmse_dtheta": 0.038718223571777344,
      "rmse_dx": 0.014785603620111942,
      "rmse_dy": 0.007847928442060947,
      "rmse_mean": 0.020450584590435028,
      "rotation_flip": 0.008988764137029648,
      "sparse_tokens": 10714.0,
      "step": 11596,
      "turn_loss": 0.18874835968017578,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5387939044787214,
      "grad_norm": 0.510246753692627,
      "learning_rate": 2.850732619213148e-08,
      "loss": 0.1255,
      "mae_dtheta": 0.009477122686803341,
      "mae_dx": 0.002291211625561118,
      "mae_dy": 0.0025706009473651648,
      "pose_mae_dtheta": 0.06773767620325089,
      "pose_mae_dx": 0.02657049521803856,
      "pose_mae_dy": 0.02828790806233883,
      "pose_rmse_dtheta": 0.1600755751132965,
      "pose_rmse_dx": 0.07822363078594208,
      "pose_rmse_dy": 0.07393020391464233,
      "pose_rmse_mean": 0.10407646745443344,
      "rmse_dtheta": 0.020314214751124382,
      "rmse_dx": 0.008005580864846706,
      "rmse_dy": 0.006886334624141455,
      "rmse_mean": 0.011735375970602036,
      "rotation_flip": 0.004134129732847214,
      "sparse_tokens": 32041.0,
      "step": 11597,
      "turn_loss": 0.09882686287164688,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.5388403642445642,
      "grad_norm": 0.40754371881484985,
      "learning_rate": 2.8366508902900604e-08,
      "loss": 0.1217,
      "mae_dtheta": 0.036469437181949615,
      "mae_dx": 0.011978790163993835,
      "mae_dy": 0.004441676661372185,
      "pose_mae_dtheta": 0.30328604578971863,
      "pose_mae_dx": 0.09098929166793823,
      "pose_mae_dy": 0.057719431817531586,
      "pose_rmse_dtheta": 0.5149316787719727,
      "pose_rmse_dx": 0.22412623465061188,
      "pose_rmse_dy": 0.1417277753353119,
      "pose_rmse_mean": 0.29359525442123413,
      "rmse_dtheta": 0.055761292576789856,
      "rmse_dx": 0.025078553706407547,
      "rmse_dy": 0.009961605072021484,
      "rmse_mean": 0.030267149209976196,
      "rotation_flip": 0.014201183803379536,
      "sparse_tokens": 13463.0,
      "step": 11598,
      "turn_loss": 0.27118703722953796,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 17210.0,
      "epoch": 0.538886824010407,
      "grad_norm": 0.9327638149261475,
      "learning_rate": 2.8226039282667762e-08,
      "loss": 0.1762,
      "mae_dtheta": 0.030730344355106354,
      "mae_dx": 0.009046090766787529,
      "mae_dy": 0.005433131009340286,
      "pose_mae_dtheta": 0.2210516631603241,
      "pose_mae_dx": 0.07630085200071335,
      "pose_mae_dy": 0.049386750906705856,
      "pose_rmse_dtheta": 0.3813953101634979,
      "pose_rmse_dx": 0.18051861226558685,
      "pose_rmse_dy": 0.12658174335956573,
      "pose_rmse_mean": 0.22949855029582977,
      "rmse_dtheta": 0.046358805149793625,
      "rmse_dx": 0.019936155527830124,
      "rmse_dy": 0.013526692055165768,
      "rmse_mean": 0.026607219129800797,
      "rotation_flip": 0.018743108958005905,
      "sparse_tokens": 13570.0,
      "step": 11599,
      "turn_loss": 0.28487592935562134,
      "turns": 53.0,
      "turns_per_sample": 53.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.5389332837762497,
      "grad_norm": 0.48153156042099,
      "learning_rate": 2.8085917341256764e-08,
      "loss": 0.1004,
      "mae_dtheta": 0.03744255751371384,
      "mae_dx": 0.014719045720994473,
      "mae_dy": 0.007869493216276169,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.48153156042099,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 152.28985595703125,
      "model/head/act_norm_mean": 102.28775601773648,
      "model/head/act_norm_min": 61.88275909423828,
      "model/head/act_over_embed": 70.2931035684481,
      "model/head/grad_frac": 0.0962899699807167,
      "model/head/grad_norm": 0.04636665806174278,
      "model/head/grad_zero_frac": 0.00019385304767638445,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6859691722972973,
      "model/head/update_ratio": 0.0007892877911217511,
      "model/head/weight_delta": 9.985867500305176,
      "model/head/weight_delta_rel": 0.17518168687820435,
      "model/head/weight_norm": 58.74493408203125,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42291876673698425,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228678753501491,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42280662059783936,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905987628920458,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1062200739979744,
      "model/modality_embedder.encoders.pose/grad_norm": 0.051148317754268646,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5432771381578947,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0016515516908839345,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156919240951538,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314638912677765,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96985626220703,
      "model/modality_embedder/grad_frac": 0.1062200739979744,
      "model/modality_embedder/grad_norm": 0.051148317754268646,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5432771381578947,
      "model/modality_embedder/update_ratio": 0.0016515516908839345,
      "model/modality_embedder/weight_delta": 3.156919240951538,
      "model/modality_embedder/weight_delta_rel": 0.10314638912677765,
      "model/modality_embedder/weight_norm": 30.96985626220703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 76.9310073852539,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.95605762012012,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.349542617797852,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.775617714544074,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.06607469916343689,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03181705251336098,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001137898419983685,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7427773475646973,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0999484583735466,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961240768432617,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 78.268798828125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.77869945838696,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.932639122009277,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.34094488749528,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.06945596635341644,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03344523906707764,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011234191479161382,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.477506160736084,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.120463527739048,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770936965942383,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 80.02960205078125,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.42652362183612,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.212852478027344,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.47334507979042,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07733205705881119,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.037237826734781265,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012112808180972934,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7674849033355713,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12650509178638458,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742521286010742,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 81.27423858642578,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.286728134384383,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.147289276123047,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.751695036322616,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08387262374162674,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.040387313812971115,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013482315698638558,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.238553762435913,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11067839711904526,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955768585205078,
      "model/normalizer/grad_frac": 0.3512882888317108,
      "model/normalizer/grad_norm": 0.16915640234947205,
      "model/normalizer/grad_zero_frac": 0.0002115311799570918,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002150527434423566,
      "model/normalizer/weight_delta": 6.810527324676514,
      "model/normalizer/weight_delta_rel": 0.08771564811468124,
      "model/normalizer/weight_norm": 78.6581039428711,
      "pose_mae_dtheta": 0.2690926790237427,
      "pose_mae_dx": 0.1156681478023529,
      "pose_mae_dy": 0.07991352677345276,
      "pose_rmse_dtheta": 0.45005422830581665,
      "pose_rmse_dx": 0.24896523356437683,
      "pose_rmse_dy": 0.194109246134758,
      "pose_rmse_mean": 0.297709584236145,
      "rmse_dtheta": 0.05486863851547241,
      "rmse_dx": 0.028424637392163277,
      "rmse_dy": 0.0180524792522192,
      "rmse_mean": 0.03378191962838173,
      "rotation_flip": 0.006410256493836641,
      "sparse_tokens": 9433.0,
      "step": 11600,
      "turn_loss": 0.34758689999580383,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "epoch": 0.5389332837762497,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.2998236119747162,
      "eval_objectnav_nopose_mae_dtheta": 0.04000313580036163,
      "eval_objectnav_nopose_mae_dx": 0.013040143996477127,
      "eval_objectnav_nopose_mae_dy": 0.004899799358099699,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32367590069770813,
      "eval_objectnav_nopose_pose_mae_dx": 0.10465338826179504,
      "eval_objectnav_nopose_pose_mae_dy": 0.054983556270599365,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5476305484771729,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22919969260692596,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1302725374698639,
      "eval_objectnav_nopose_pose_rmse_mean": 0.302367627620697,
      "eval_objectnav_nopose_rmse_dtheta": 0.05790923908352852,
      "eval_objectnav_nopose_rmse_dx": 0.025598689913749695,
      "eval_objectnav_nopose_rmse_dy": 0.010090040042996407,
      "eval_objectnav_nopose_rmse_mean": 0.031199321150779724,
      "eval_objectnav_nopose_rotation_flip": 0.015245793387293816,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.2998236119747162,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 11600
    },
    {
      "epoch": 0.5389332837762497,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.26877763867378235,
      "eval_objectnav_pose_mae_dtheta": 0.03499544784426689,
      "eval_objectnav_pose_mae_dx": 0.011083330027759075,
      "eval_objectnav_pose_mae_dy": 0.004542479291558266,
      "eval_objectnav_pose_pose_mae_dtheta": 0.260116308927536,
      "eval_objectnav_pose_pose_mae_dx": 0.08676587045192719,
      "eval_objectnav_pose_pose_mae_dy": 0.04705561324954033,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4584376811981201,
      "eval_objectnav_pose_pose_rmse_dx": 0.20211490988731384,
      "eval_objectnav_pose_pose_rmse_dy": 0.11609555780887604,
      "eval_objectnav_pose_pose_rmse_mean": 0.2588827311992645,
      "eval_objectnav_pose_rmse_dtheta": 0.05271141603589058,
      "eval_objectnav_pose_rmse_dx": 0.023190811276435852,
      "eval_objectnav_pose_rmse_dy": 0.009674281813204288,
      "eval_objectnav_pose_rmse_mean": 0.028525501489639282,
      "eval_objectnav_pose_rotation_flip": 0.014489623717963696,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.26877763867378235,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 11600
    },
    {
      "epoch": 0.5389332837762497,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08699879050254822,
      "eval_pointnav_mae_dtheta": 0.009902507066726685,
      "eval_pointnav_mae_dx": 0.002182986354455352,
      "eval_pointnav_mae_dy": 0.0022881682962179184,
      "eval_pointnav_pose_mae_dtheta": 0.06783400475978851,
      "eval_pointnav_pose_mae_dx": 0.023714711889624596,
      "eval_pointnav_pose_mae_dy": 0.0239399466663599,
      "eval_pointnav_pose_rmse_dtheta": 0.19982412457466125,
      "eval_pointnav_pose_rmse_dx": 0.07608503103256226,
      "eval_pointnav_pose_rmse_dy": 0.07019056379795074,
      "eval_pointnav_pose_rmse_mean": 0.11536657810211182,
      "eval_pointnav_rmse_dtheta": 0.025033509358763695,
      "eval_pointnav_rmse_dx": 0.007186324335634708,
      "eval_pointnav_rmse_dy": 0.006200514733791351,
      "eval_pointnav_rmse_mean": 0.012806783430278301,
      "eval_pointnav_rotation_flip": 0.004990048706531525,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08699879050254822,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 11600
    },
    {
      "epoch": 0.5389332837762497,
      "eval_loss": 0.2185333470503489,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.2998236119747162,
      "eval_objectnav_nopose_mae_dtheta": 0.04000313580036163,
      "eval_objectnav_nopose_mae_dx": 0.013040143996477127,
      "eval_objectnav_nopose_mae_dy": 0.004899799358099699,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.32367590069770813,
      "eval_objectnav_nopose_pose_mae_dx": 0.10465338826179504,
      "eval_objectnav_nopose_pose_mae_dy": 0.054983556270599365,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5476305484771729,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22919969260692596,
      "eval_objectnav_nopose_pose_rmse_dy": 0.1302725374698639,
      "eval_objectnav_nopose_pose_rmse_mean": 0.302367627620697,
      "eval_objectnav_nopose_rmse_dtheta": 0.05790923908352852,
      "eval_objectnav_nopose_rmse_dx": 0.025598689913749695,
      "eval_objectnav_nopose_rmse_dy": 0.010090040042996407,
      "eval_objectnav_nopose_rmse_mean": 0.031199321150779724,
      "eval_objectnav_nopose_rotation_flip": 0.015245793387293816,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.2998236119747162,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.26877763867378235,
      "eval_objectnav_pose_mae_dtheta": 0.03499544784426689,
      "eval_objectnav_pose_mae_dx": 0.011083330027759075,
      "eval_objectnav_pose_mae_dy": 0.004542479291558266,
      "eval_objectnav_pose_pose_mae_dtheta": 0.260116308927536,
      "eval_objectnav_pose_pose_mae_dx": 0.08676587045192719,
      "eval_objectnav_pose_pose_mae_dy": 0.04705561324954033,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4584376811981201,
      "eval_objectnav_pose_pose_rmse_dx": 0.20211490988731384,
      "eval_objectnav_pose_pose_rmse_dy": 0.11609555780887604,
      "eval_objectnav_pose_pose_rmse_mean": 0.2588827311992645,
      "eval_objectnav_pose_rmse_dtheta": 0.05271141603589058,
      "eval_objectnav_pose_rmse_dx": 0.023190811276435852,
      "eval_objectnav_pose_rmse_dy": 0.009674281813204288,
      "eval_objectnav_pose_rmse_mean": 0.028525501489639282,
      "eval_objectnav_pose_rotation_flip": 0.014489623717963696,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.26877763867378235,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08699879050254822,
      "eval_pointnav_mae_dtheta": 0.009902507066726685,
      "eval_pointnav_mae_dx": 0.002182986354455352,
      "eval_pointnav_mae_dy": 0.0022881682962179184,
      "eval_pointnav_pose_mae_dtheta": 0.06783400475978851,
      "eval_pointnav_pose_mae_dx": 0.023714711889624596,
      "eval_pointnav_pose_mae_dy": 0.0239399466663599,
      "eval_pointnav_pose_rmse_dtheta": 0.19982412457466125,
      "eval_pointnav_pose_rmse_dx": 0.07608503103256226,
      "eval_pointnav_pose_rmse_dy": 0.07019056379795074,
      "eval_pointnav_pose_rmse_mean": 0.11536657810211182,
      "eval_pointnav_rmse_dtheta": 0.025033509358763695,
      "eval_pointnav_rmse_dx": 0.007186324335634708,
      "eval_pointnav_rmse_dy": 0.006200514733791351,
      "eval_pointnav_rmse_mean": 0.012806783430278301,
      "eval_pointnav_rotation_flip": 0.004990048706531525,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08699879050254822,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 11600
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.5389797435420925,
      "grad_norm": 0.5138291120529175,
      "learning_rate": 2.7946143088466437e-08,
      "loss": 0.1337,
      "mae_dtheta": 0.022762326523661613,
      "mae_dx": 0.0045382678508758545,
      "mae_dy": 0.004316860344260931,
      "pose_mae_dtheta": 0.1399131566286087,
      "pose_mae_dx": 0.034192200750112534,
      "pose_mae_dy": 0.050776880234479904,
      "pose_rmse_dtheta": 0.325898140668869,
      "pose_rmse_dx": 0.09288835525512695,
      "pose_rmse_dy": 0.11368740350008011,
      "pose_rmse_mean": 0.17749130725860596,
      "rmse_dtheta": 0.04191317409276962,
      "rmse_dx": 0.01294802501797676,
      "rmse_dy": 0.008539621718227863,
      "rmse_mean": 0.021133607253432274,
      "rotation_flip": 0.007117437664419413,
      "sparse_tokens": 10938.0,
      "step": 11601,
      "turn_loss": 0.1885157823562622,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.5390262033079354,
      "grad_norm": 0.6358988285064697,
      "learning_rate": 2.7806716534070632e-08,
      "loss": 0.1431,
      "mae_dtheta": 0.03824200853705406,
      "mae_dx": 0.012063013389706612,
      "mae_dy": 0.006079658400267363,
      "pose_mae_dtheta": 0.2951917350292206,
      "pose_mae_dx": 0.0927778109908104,
      "pose_mae_dy": 0.04174916446208954,
      "pose_rmse_dtheta": 0.5515220165252686,
      "pose_rmse_dx": 0.22256751358509064,
      "pose_rmse_dy": 0.08630376309156418,
      "pose_rmse_mean": 0.28679776191711426,
      "rmse_dtheta": 0.06004256010055542,
      "rmse_dx": 0.024655040353536606,
      "rmse_dy": 0.011974449269473553,
      "rmse_mean": 0.03222401812672615,
      "rotation_flip": 0.01225490216165781,
      "sparse_tokens": 6678.0,
      "step": 11602,
      "turn_loss": 0.3050466775894165,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5390726630737781,
      "grad_norm": 0.567355215549469,
      "learning_rate": 2.7667637687820436e-08,
      "loss": 0.1322,
      "mae_dtheta": 0.008502018637955189,
      "mae_dx": 0.0011953525245189667,
      "mae_dy": 0.001973416656255722,
      "pose_mae_dtheta": 0.05316714197397232,
      "pose_mae_dx": 0.01538474578410387,
      "pose_mae_dy": 0.024326540529727936,
      "pose_rmse_dtheta": 0.11631855368614197,
      "pose_rmse_dx": 0.0374993234872818,
      "pose_rmse_dy": 0.0607144869863987,
      "pose_rmse_mean": 0.07151079177856445,
      "rmse_dtheta": 0.01803998276591301,
      "rmse_dx": 0.004490287974476814,
      "rmse_dy": 0.005204902961850166,
      "rmse_mean": 0.00924505852162838,
      "rotation_flip": 0.007764609530568123,
      "sparse_tokens": 32073.0,
      "step": 11603,
      "turn_loss": 0.07436812669038773,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 33312.0,
      "epoch": 0.5391191228396209,
      "grad_norm": 0.6808140873908997,
      "learning_rate": 2.7528906559440295e-08,
      "loss": 0.1826,
      "mae_dtheta": 0.03472521901130676,
      "mae_dx": 0.01675853133201599,
      "mae_dy": 0.005634441040456295,
      "pose_mae_dtheta": 0.26663145422935486,
      "pose_mae_dx": 0.12459610402584076,
      "pose_mae_dy": 0.06532393395900726,
      "pose_rmse_dtheta": 0.47921162843704224,
      "pose_rmse_dx": 0.27485427260398865,
      "pose_rmse_dy": 0.15766458213329315,
      "pose_rmse_mean": 0.30391016602516174,
      "rmse_dtheta": 0.052145179361104965,
      "rmse_dx": 0.031100846827030182,
      "rmse_dy": 0.011392965912818909,
      "rmse_mean": 0.03154633194208145,
      "rotation_flip": 0.011264080181717873,
      "sparse_tokens": 26483.0,
      "step": 11604,
      "turn_loss": 0.299110472202301,
      "turns": 103.0,
      "turns_per_sample": 103.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5391655826054637,
      "grad_norm": 0.5491158366203308,
      "learning_rate": 2.7390523158633552e-08,
      "loss": 0.1511,
      "mae_dtheta": 0.013663075864315033,
      "mae_dx": 0.0027571211103349924,
      "mae_dy": 0.00455284072086215,
      "pose_mae_dtheta": 0.07788363844156265,
      "pose_mae_dx": 0.03422411158680916,
      "pose_mae_dy": 0.03756184130907059,
      "pose_rmse_dtheta": 0.13759948313236237,
      "pose_rmse_dx": 0.08844314515590668,
      "pose_rmse_dy": 0.0785050243139267,
      "pose_rmse_mean": 0.10151588916778564,
      "rmse_dtheta": 0.023289302363991737,
      "rmse_dx": 0.007572444621473551,
      "rmse_dy": 0.00913633406162262,
      "rmse_mean": 0.013332693837583065,
      "rotation_flip": 0.005782017949968576,
      "sparse_tokens": 32105.0,
      "step": 11605,
      "turn_loss": 0.12452913820743561,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5392120423713065,
      "grad_norm": 0.3340432643890381,
      "learning_rate": 2.7252487495075807e-08,
      "loss": 0.0827,
      "mae_dtheta": 0.009782996959984303,
      "mae_dx": 0.0018413994694128633,
      "mae_dy": 0.0022700412664562464,
      "pose_mae_dtheta": 0.06446897983551025,
      "pose_mae_dx": 0.017141269519925117,
      "pose_mae_dy": 0.024621538817882538,
      "pose_rmse_dtheta": 0.13198108971118927,
      "pose_rmse_dx": 0.041881389915943146,
      "pose_rmse_dy": 0.05419911816716194,
      "pose_rmse_mean": 0.07602053880691528,
      "rmse_dtheta": 0.0191254373639822,
      "rmse_dx": 0.005656794179230928,
      "rmse_dy": 0.005863566417247057,
      "rmse_mean": 0.010215265676379204,
      "rotation_flip": 0.00712678162381053,
      "sparse_tokens": 32153.0,
      "step": 11606,
      "turn_loss": 0.08924952149391174,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4250.0,
      "epoch": 0.5392585021371492,
      "grad_norm": 0.6163190603256226,
      "learning_rate": 2.7114799578421002e-08,
      "loss": 0.0953,
      "mae_dtheta": 0.041957754641771317,
      "mae_dx": 0.013033226132392883,
      "mae_dy": 0.0035307754296809435,
      "pose_mae_dtheta": 0.3333747684955597,
      "pose_mae_dx": 0.1012081652879715,
      "pose_mae_dy": 0.03763984516263008,
      "pose_rmse_dtheta": 0.5291754007339478,
      "pose_rmse_dx": 0.20945443212985992,
      "pose_rmse_dy": 0.07037303596735,
      "pose_rmse_mean": 0.2696676254272461,
      "rmse_dtheta": 0.06101474538445473,
      "rmse_dx": 0.025329647585749626,
      "rmse_dy": 0.007391992956399918,
      "rmse_mean": 0.031245460733771324,
      "rotation_flip": 0.004807692486792803,
      "sparse_tokens": 3218.0,
      "step": 11607,
      "turn_loss": 0.260573148727417,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.539304961902992,
      "grad_norm": 0.5198467969894409,
      "learning_rate": 2.6977459418296992e-08,
      "loss": 0.1024,
      "mae_dtheta": 0.008407708257436752,
      "mae_dx": 0.0011562384897843003,
      "mae_dy": 0.0015987163642421365,
      "pose_mae_dtheta": 0.05133136361837387,
      "pose_mae_dx": 0.012585209682583809,
      "pose_mae_dy": 0.01422868575900793,
      "pose_rmse_dtheta": 0.18378639221191406,
      "pose_rmse_dx": 0.034051816910505295,
      "pose_rmse_dy": 0.03419000655412674,
      "pose_rmse_mean": 0.08400940895080566,
      "rmse_dtheta": 0.022966653108596802,
      "rmse_dx": 0.003916909918189049,
      "rmse_dy": 0.004713039845228195,
      "rmse_mean": 0.010532200336456299,
      "rotation_flip": 0.0016985137481242418,
      "sparse_tokens": 32121.0,
      "step": 11608,
      "turn_loss": 0.05667455121874809,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.5393514216688348,
      "grad_norm": 0.7192773222923279,
      "learning_rate": 2.684046702430887e-08,
      "loss": 0.1379,
      "mae_dtheta": 0.04485757648944855,
      "mae_dx": 0.012168456800282001,
      "mae_dy": 0.00816138181835413,
      "pose_mae_dtheta": 0.3901865780353546,
      "pose_mae_dx": 0.11579596996307373,
      "pose_mae_dy": 0.08005037158727646,
      "pose_rmse_dtheta": 0.6901172399520874,
      "pose_rmse_dx": 0.24560511112213135,
      "pose_rmse_dy": 0.22359126806259155,
      "pose_rmse_mean": 0.38643789291381836,
      "rmse_dtheta": 0.06794945895671844,
      "rmse_dx": 0.023793432861566544,
      "rmse_dy": 0.018789924681186676,
      "rmse_mean": 0.036844272166490555,
      "rotation_flip": 0.009852216579020023,
      "sparse_tokens": 10067.0,
      "step": 11609,
      "turn_loss": 0.3397163152694702,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5393978814346776,
      "grad_norm": 0.410858690738678,
      "learning_rate": 2.6703822406036193e-08,
      "loss": 0.0604,
      "mae_dtheta": 0.005521739833056927,
      "mae_dx": 0.0008169677457772195,
      "mae_dy": 0.0005699666799046099,
      "pose_mae_dtheta": 0.03750883787870407,
      "pose_mae_dx": 0.006971660535782576,
      "pose_mae_dy": 0.008844448253512383,
      "pose_rmse_dtheta": 0.1603095829486847,
      "pose_rmse_dx": 0.01753021776676178,
      "pose_rmse_dy": 0.026027517393231392,
      "pose_rmse_mean": 0.06795577704906464,
      "rmse_dtheta": 0.02045913226902485,
      "rmse_dx": 0.0028183460235595703,
      "rmse_dy": 0.0013880430487915874,
      "rmse_mean": 0.008221840485930443,
      "rotation_flip": 0.0011976048117503524,
      "sparse_tokens": 32121.0,
      "step": 11610,
      "turn_loss": 0.033458903431892395,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5394443412005203,
      "grad_norm": 0.2877909243106842,
      "learning_rate": 2.6567525573034102e-08,
      "loss": 0.0714,
      "mae_dtheta": 0.011341666802763939,
      "mae_dx": 0.0031326734460890293,
      "mae_dy": 0.003936938475817442,
      "pose_mae_dtheta": 0.07645577937364578,
      "pose_mae_dx": 0.03944139555096626,
      "pose_mae_dy": 0.036261167377233505,
      "pose_rmse_dtheta": 0.16610509157180786,
      "pose_rmse_dx": 0.09517546743154526,
      "pose_rmse_dy": 0.08610137552022934,
      "pose_rmse_mean": 0.11579398810863495,
      "rmse_dtheta": 0.02393236570060253,
      "rmse_dx": 0.008204410783946514,
      "rmse_dy": 0.008879465982317924,
      "rmse_mean": 0.013672081753611565,
      "rotation_flip": 0.011624044738709927,
      "sparse_tokens": 32153.0,
      "step": 11611,
      "turn_loss": 0.1225719004869461,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5394908009663631,
      "grad_norm": 0.6395024061203003,
      "learning_rate": 2.6431576534834412e-08,
      "loss": 0.1621,
      "mae_dtheta": 0.008696482516825199,
      "mae_dx": 0.0013577172067016363,
      "mae_dy": 0.0019473190186545253,
      "pose_mae_dtheta": 0.0578286275267601,
      "pose_mae_dx": 0.015267608687281609,
      "pose_mae_dy": 0.020741265267133713,
      "pose_rmse_dtheta": 0.1484440118074417,
      "pose_rmse_dx": 0.04069647192955017,
      "pose_rmse_dy": 0.05019574984908104,
      "pose_rmse_mean": 0.0797787457704544,
      "rmse_dtheta": 0.01996270753443241,
      "rmse_dx": 0.00397926801815629,
      "rmse_dy": 0.004622967913746834,
      "rmse_mean": 0.009521648287773132,
      "rotation_flip": 0.0025662959087640047,
      "sparse_tokens": 32105.0,
      "step": 11612,
      "turn_loss": 0.08375893533229828,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5395372607322059,
      "grad_norm": 0.6155774593353271,
      "learning_rate": 2.629597530094452e-08,
      "loss": 0.1277,
      "mae_dtheta": 0.011534850113093853,
      "mae_dx": 0.0026223394088447094,
      "mae_dy": 0.0034187189303338528,
      "pose_mae_dtheta": 0.07856343686580658,
      "pose_mae_dx": 0.027034318074584007,
      "pose_mae_dy": 0.03074975125491619,
      "pose_rmse_dtheta": 0.1681310534477234,
      "pose_rmse_dx": 0.07228251546621323,
      "pose_rmse_dy": 0.07053098827600479,
      "pose_rmse_mean": 0.10364818572998047,
      "rmse_dtheta": 0.023317556828260422,
      "rmse_dx": 0.007235444150865078,
      "rmse_dy": 0.008017996326088905,
      "rmse_mean": 0.012857000343501568,
      "rotation_flip": 0.006877579260617495,
      "sparse_tokens": 32169.0,
      "step": 11613,
      "turn_loss": 0.10418560355901718,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5395837204980487,
      "grad_norm": 0.9423881769180298,
      "learning_rate": 2.6160721880846286e-08,
      "loss": 0.1567,
      "mae_dtheta": 0.010721671395003796,
      "mae_dx": 0.001786573207937181,
      "mae_dy": 0.0029002996161580086,
      "pose_mae_dtheta": 0.07989327609539032,
      "pose_mae_dx": 0.022503562271595,
      "pose_mae_dy": 0.02673337608575821,
      "pose_rmse_dtheta": 0.2579350769519806,
      "pose_rmse_dx": 0.07233984768390656,
      "pose_rmse_dy": 0.09681183099746704,
      "pose_rmse_mean": 0.14236226677894592,
      "rmse_dtheta": 0.028521515429019928,
      "rmse_dx": 0.00569009268656373,
      "rmse_dy": 0.008789602667093277,
      "rmse_mean": 0.014333738014101982,
      "rotation_flip": 0.010116337798535824,
      "sparse_tokens": 32057.0,
      "step": 11614,
      "turn_loss": 0.08835233002901077,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19418.0,
      "epoch": 0.5396301802638914,
      "grad_norm": 0.5214297771453857,
      "learning_rate": 2.602581628399825e-08,
      "loss": 0.105,
      "mae_dtheta": 0.03393620625138283,
      "mae_dx": 0.01281220093369484,
      "mae_dy": 0.004941499326378107,
      "pose_mae_dtheta": 0.27544623613357544,
      "pose_mae_dx": 0.0949292778968811,
      "pose_mae_dy": 0.055734783411026,
      "pose_rmse_dtheta": 0.4550093412399292,
      "pose_rmse_dx": 0.20253224670886993,
      "pose_rmse_dy": 0.12025201320648193,
      "pose_rmse_mean": 0.2592645287513733,
      "rmse_dtheta": 0.048660989850759506,
      "rmse_dx": 0.025301335379481316,
      "rmse_dy": 0.009704429656267166,
      "rmse_mean": 0.027888920158147812,
      "rotation_flip": 0.020066889002919197,
      "sparse_tokens": 14898.0,
      "step": 11615,
      "turn_loss": 0.2616918087005615,
      "turns": 60.0,
      "turns_per_sample": 60.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5396766400297343,
      "grad_norm": 0.48300305008888245,
      "learning_rate": 2.5891258519835094e-08,
      "loss": 0.1272,
      "mae_dtheta": 0.008700760081410408,
      "mae_dx": 0.0014430886367335916,
      "mae_dy": 0.0026407355908304453,
      "pose_mae_dtheta": 0.062462713569402695,
      "pose_mae_dx": 0.021927468478679657,
      "pose_mae_dy": 0.029553866013884544,
      "pose_rmse_dtheta": 0.14361827075481415,
      "pose_rmse_dx": 0.0642930269241333,
      "pose_rmse_dy": 0.06922323256731033,
      "pose_rmse_mean": 0.09237818419933319,
      "rmse_dtheta": 0.018497636541724205,
      "rmse_dx": 0.004120635334402323,
      "rmse_dy": 0.006526927929371595,
      "rmse_mean": 0.009715067222714424,
      "rotation_flip": 0.004027828574180603,
      "sparse_tokens": 32089.0,
      "step": 11616,
      "turn_loss": 0.06080622598528862,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.539723099795577,
      "grad_norm": 0.5066077709197998,
      "learning_rate": 2.57570485977654e-08,
      "loss": 0.1176,
      "mae_dtheta": 0.02778993919491768,
      "mae_dx": 0.008990996517241001,
      "mae_dy": 0.0041142841801047325,
      "pose_mae_dtheta": 0.2045402079820633,
      "pose_mae_dx": 0.07886029034852982,
      "pose_mae_dy": 0.04563005268573761,
      "pose_rmse_dtheta": 0.41518735885620117,
      "pose_rmse_dx": 0.16456258296966553,
      "pose_rmse_dy": 0.10472393035888672,
      "pose_rmse_mean": 0.22815796732902527,
      "rmse_dtheta": 0.045722801238298416,
      "rmse_dx": 0.018401967361569405,
      "rmse_dy": 0.006860286463052034,
      "rmse_mean": 0.02366168610751629,
      "rotation_flip": 0.002320185536518693,
      "sparse_tokens": 6898.0,
      "step": 11617,
      "turn_loss": 0.24344931542873383,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 26282.0,
      "epoch": 0.5397695595614198,
      "grad_norm": 0.5675685405731201,
      "learning_rate": 2.562318652717555e-08,
      "loss": 0.1038,
      "mae_dtheta": 0.028763780370354652,
      "mae_dx": 0.008165469393134117,
      "mae_dy": 0.003007178194820881,
      "pose_mae_dtheta": 0.2258979231119156,
      "pose_mae_dx": 0.060388561338186264,
      "pose_mae_dy": 0.0319221094250679,
      "pose_rmse_dtheta": 0.4300336539745331,
      "pose_rmse_dx": 0.14844724535942078,
      "pose_rmse_dy": 0.08360523730516434,
      "pose_rmse_mean": 0.2206953763961792,
      "rmse_dtheta": 0.047033004462718964,
      "rmse_dx": 0.018346045166254044,
      "rmse_dy": 0.007350066676735878,
      "rmse_mean": 0.02424304001033306,
      "rotation_flip": 0.0139860138297081,
      "sparse_tokens": 19806.0,
      "step": 11618,
      "turn_loss": 0.1772107630968094,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 26848.0,
      "epoch": 0.5398160193272626,
      "grad_norm": 0.6180048584938049,
      "learning_rate": 2.548967231742583e-08,
      "loss": 0.1545,
      "mae_dtheta": 0.03427783027291298,
      "mae_dx": 0.012127445079386234,
      "mae_dy": 0.0036390458699315786,
      "pose_mae_dtheta": 0.2646034061908722,
      "pose_mae_dx": 0.09866434335708618,
      "pose_mae_dy": 0.04126749560236931,
      "pose_rmse_dtheta": 0.48523497581481934,
      "pose_rmse_dx": 0.2299666851758957,
      "pose_rmse_dy": 0.11277304589748383,
      "pose_rmse_mean": 0.2759915888309479,
      "rmse_dtheta": 0.054468587040901184,
      "rmse_dx": 0.024928739294409752,
      "rmse_dy": 0.008712958544492722,
      "rmse_mean": 0.02937009558081627,
      "rotation_flip": 0.012615643441677094,
      "sparse_tokens": 21779.0,
      "step": 11619,
      "turn_loss": 0.24893882870674133,
      "turns": 83.0,
      "turns_per_sample": 83.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5398624790931054,
      "grad_norm": 0.376228004693985,
      "learning_rate": 2.535650597785322e-08,
      "loss": 0.0935,
      "mae_dtheta": 0.010068433359265327,
      "mae_dx": 0.0011886112624779344,
      "mae_dy": 0.0018780718091875315,
      "pose_mae_dtheta": 0.06413465738296509,
      "pose_mae_dx": 0.017969664186239243,
      "pose_mae_dy": 0.024010006338357925,
      "pose_rmse_dtheta": 0.16944803297519684,
      "pose_rmse_dx": 0.04671160504221916,
      "pose_rmse_dy": 0.06850870698690414,
      "pose_rmse_mean": 0.09488945454359055,
      "rmse_dtheta": 0.023818394169211388,
      "rmse_dx": 0.003534255549311638,
      "rmse_dy": 0.004290233366191387,
      "rmse_mean": 0.010547628626227379,
      "rotation_flip": 0.0018889309139922261,
      "sparse_tokens": 32121.0,
      "step": 11620,
      "turn_loss": 0.08397979289293289,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5399089388589482,
      "grad_norm": 0.3753111660480499,
      "learning_rate": 2.5223687517770823e-08,
      "loss": 0.1139,
      "mae_dtheta": 0.011347456835210323,
      "mae_dx": 0.0016879902686923742,
      "mae_dy": 0.0032416731119155884,
      "pose_mae_dtheta": 0.07428263872861862,
      "pose_mae_dx": 0.024325905367732048,
      "pose_mae_dy": 0.033413857221603394,
      "pose_rmse_dtheta": 0.17270059883594513,
      "pose_rmse_dx": 0.059721194207668304,
      "pose_rmse_dy": 0.08138085156679153,
      "pose_rmse_mean": 0.10460087656974792,
      "rmse_dtheta": 0.02335154078900814,
      "rmse_dx": 0.004696398973464966,
      "rmse_dy": 0.006909130606800318,
      "rmse_mean": 0.011652356944978237,
      "rotation_flip": 0.006300963461399078,
      "sparse_tokens": 32073.0,
      "step": 11621,
      "turn_loss": 0.09561821818351746,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.5399553986247909,
      "grad_norm": 0.32832735776901245,
      "learning_rate": 2.5091216946465657e-08,
      "loss": 0.0702,
      "mae_dtheta": 0.007849141024053097,
      "mae_dx": 0.001601377152837813,
      "mae_dy": 0.0018921724986284971,
      "pose_mae_dtheta": 0.04931533709168434,
      "pose_mae_dx": 0.016745734959840775,
      "pose_mae_dy": 0.018311917781829834,
      "pose_rmse_dtheta": 0.14209677278995514,
      "pose_rmse_dx": 0.04200909659266472,
      "pose_rmse_dy": 0.04280807822942734,
      "pose_rmse_mean": 0.07563798874616623,
      "rmse_dtheta": 0.01948501728475094,
      "rmse_dx": 0.004257666878402233,
      "rmse_dy": 0.004876082297414541,
      "rmse_mean": 0.009539589285850525,
      "rotation_flip": 0.0058823530562222,
      "sparse_tokens": 32201.0,
      "step": 11622,
      "turn_loss": 0.07430924475193024,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.5400018583906337,
      "grad_norm": 0.6991817355155945,
      "learning_rate": 2.495909427320198e-08,
      "loss": 0.2434,
      "mae_dtheta": 0.030306730419397354,
      "mae_dx": 0.010946611873805523,
      "mae_dy": 0.005884089507162571,
      "pose_mae_dtheta": 0.23289857804775238,
      "pose_mae_dx": 0.08514389395713806,
      "pose_mae_dy": 0.06017959862947464,
      "pose_rmse_dtheta": 0.42679330706596375,
      "pose_rmse_dx": 0.19253230094909668,
      "pose_rmse_dy": 0.10964298993349075,
      "pose_rmse_mean": 0.24298954010009766,
      "rmse_dtheta": 0.04585495963692665,
      "rmse_dx": 0.022670291364192963,
      "rmse_dy": 0.010710472241044044,
      "rmse_mean": 0.026411909610033035,
      "rotation_flip": 0.016331657767295837,
      "sparse_tokens": 13095.0,
      "step": 11623,
      "turn_loss": 0.2386488914489746,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5400483181564765,
      "grad_norm": 0.5860482454299927,
      "learning_rate": 2.4827319507219062e-08,
      "loss": 0.1569,
      "mae_dtheta": 0.004643794149160385,
      "mae_dx": 0.0011334241135045886,
      "mae_dy": 0.0003738204250112176,
      "pose_mae_dtheta": 0.030856965109705925,
      "pose_mae_dx": 0.007930919528007507,
      "pose_mae_dy": 0.0040064589120447636,
      "pose_rmse_dtheta": 0.17392778396606445,
      "pose_rmse_dx": 0.032889652997255325,
      "pose_rmse_dy": 0.012835466302931309,
      "pose_rmse_mean": 0.07321763783693314,
      "rmse_dtheta": 0.02156902849674225,
      "rmse_dx": 0.0046430667862296104,
      "rmse_dy": 0.0014418591745197773,
      "rmse_mean": 0.009217984974384308,
      "rotation_flip": 0.002673796843737364,
      "sparse_tokens": 32105.0,
      "step": 11624,
      "turn_loss": 0.029502203688025475,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5400947779223193,
      "grad_norm": 0.4270232617855072,
      "learning_rate": 2.4695892657732314e-08,
      "loss": 0.086,
      "mae_dtheta": 0.009453418664634228,
      "mae_dx": 0.0021340670064091682,
      "mae_dy": 0.002334203803911805,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.42702341079711914,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.23426818847656,
      "model/head/act_norm_mean": 108.0083648989899,
      "model/head/act_norm_min": 56.19235610961914,
      "model/head/act_over_embed": 74.2243595488296,
      "model/head/grad_frac": 0.09248355776071548,
      "model/head/grad_norm": 0.0394926443696022,
      "model/head/grad_zero_frac": 0.00018528671353124082,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7042199337121212,
      "model/head/update_ratio": 0.0006722730468027294,
      "model/head/weight_delta": 9.985918045043945,
      "model/head/weight_delta_rel": 0.17518258094787598,
      "model/head/weight_norm": 58.74494552612305,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229428768157959,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228705203894413,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.422787070274353,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29060058058781063,
      "model/modality_embedder.encoders.pose/grad_frac": 0.14146266877651215,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06040787324309349,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5548396915584416,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0019505376694723964,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569416522979736,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314712673425674,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969858169555664,
      "model/modality_embedder/grad_frac": 0.14146266877651215,
      "model/modality_embedder/grad_norm": 0.06040787324309349,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5548396915584416,
      "model/modality_embedder/update_ratio": 0.0019505376694723964,
      "model/modality_embedder/weight_delta": 3.1569416522979736,
      "model/modality_embedder/weight_delta_rel": 0.10314712673425674,
      "model/modality_embedder/weight_norm": 30.969858169555664,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.42074584960938,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.459302849927848,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.874011993408203,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.121452547924015,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05901561677455902,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02520105056464672,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0009012848604470491,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7428104877471924,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0999496728181839,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96124839782715,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.96913146972656,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.44617554513388,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.32933521270752,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.79964070331734,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05790892615914345,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02472846768796444,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0008306241943500936,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4775421619415283,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12046477943658829,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770944595336914,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.8465347290039,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.24684844476511,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.265002250671387,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.037079978109215,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.060882773250341415,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.025998368859291077,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008456807117909193,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7675294876098633,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12650658190250397,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742534637451172,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.73110961914062,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.98735369568703,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.38652515411377,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.233171481409645,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06349945068359375,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.027115751057863235,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009051927481777966,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2385916709899902,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11067969352006912,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95577621459961,
      "model/normalizer/grad_frac": 0.24684157967567444,
      "model/normalizer/grad_norm": 0.10540713369846344,
      "model/normalizer/grad_zero_frac": 0.0002517102693673223,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001340066664852202,
      "model/normalizer/weight_delta": 6.810606002807617,
      "model/normalizer/weight_delta_rel": 0.08771666139364243,
      "model/normalizer/weight_norm": 78.65812683105469,
      "pose_mae_dtheta": 0.06269387155771255,
      "pose_mae_dx": 0.01826351508498192,
      "pose_mae_dy": 0.019765036180615425,
      "pose_rmse_dtheta": 0.17504698038101196,
      "pose_rmse_dx": 0.05292828008532524,
      "pose_rmse_dy": 0.04423125833272934,
      "pose_rmse_mean": 0.09073550999164581,
      "rmse_dtheta": 0.02353932149708271,
      "rmse_dx": 0.00707014137879014,
      "rmse_dy": 0.007053720764815807,
      "rmse_mean": 0.012554395012557507,
      "rotation_flip": 0.0036900369450449944,
      "sparse_tokens": 32169.0,
      "step": 11625,
      "turn_loss": 0.08783254027366638,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13322.0,
      "epoch": 0.540141237688162,
      "grad_norm": 0.9316074848175049,
      "learning_rate": 2.4564813733932157e-08,
      "loss": 0.2178,
      "mae_dtheta": 0.03148464858531952,
      "mae_dx": 0.008763319812715054,
      "mae_dy": 0.005682241637259722,
      "pose_mae_dtheta": 0.21584279835224152,
      "pose_mae_dx": 0.07608801126480103,
      "pose_mae_dy": 0.060354601591825485,
      "pose_rmse_dtheta": 0.3895501494407654,
      "pose_rmse_dx": 0.18921901285648346,
      "pose_rmse_dy": 0.1314624696969986,
      "pose_rmse_mean": 0.23674386739730835,
      "rmse_dtheta": 0.04992181062698364,
      "rmse_dx": 0.020776329562067986,
      "rmse_dy": 0.010142765007913113,
      "rmse_mean": 0.02694696933031082,
      "rotation_flip": 0.009985734708607197,
      "sparse_tokens": 11194.0,
      "step": 11626,
      "turn_loss": 0.23310893774032593,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 26524.0,
      "epoch": 0.5401876974540049,
      "grad_norm": 0.35442054271698,
      "learning_rate": 2.44340827449846e-08,
      "loss": 0.0962,
      "mae_dtheta": 0.04002862423658371,
      "mae_dx": 0.012163247913122177,
      "mae_dy": 0.004148043226450682,
      "pose_mae_dtheta": 0.3320181965827942,
      "pose_mae_dx": 0.08688420802354813,
      "pose_mae_dy": 0.059196364134550095,
      "pose_rmse_dtheta": 0.532463014125824,
      "pose_rmse_dx": 0.19307906925678253,
      "pose_rmse_dy": 0.14808949828147888,
      "pose_rmse_mean": 0.2912105321884155,
      "rmse_dtheta": 0.05696355924010277,
      "rmse_dx": 0.024249199777841568,
      "rmse_dy": 0.008923422545194626,
      "rmse_mean": 0.030045395717024803,
      "rotation_flip": 0.009651076048612595,
      "sparse_tokens": 20017.0,
      "step": 11627,
      "turn_loss": 0.2902047634124756,
      "turns": 82.0,
      "turns_per_sample": 82.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5402341572198476,
      "grad_norm": 0.4035691022872925,
      "learning_rate": 2.4303699700032878e-08,
      "loss": 0.1251,
      "mae_dtheta": 0.011729460209608078,
      "mae_dx": 0.0012926075141876936,
      "mae_dy": 0.002311126561835408,
      "pose_mae_dtheta": 0.07320907711982727,
      "pose_mae_dx": 0.019336747005581856,
      "pose_mae_dy": 0.03010164573788643,
      "pose_rmse_dtheta": 0.18955841660499573,
      "pose_rmse_dx": 0.051132991909980774,
      "pose_rmse_dy": 0.06786695867776871,
      "pose_rmse_mean": 0.10285279154777527,
      "rmse_dtheta": 0.02348320186138153,
      "rmse_dx": 0.00407352764159441,
      "rmse_dy": 0.005209564696997404,
      "rmse_mean": 0.010922098532319069,
      "rotation_flip": 0.005133470054715872,
      "sparse_tokens": 32105.0,
      "step": 11628,
      "turn_loss": 0.08073923736810684,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.5402806169856904,
      "grad_norm": 0.6998637318611145,
      "learning_rate": 2.4173664608193592e-08,
      "loss": 0.1503,
      "mae_dtheta": 0.027456751093268394,
      "mae_dx": 0.01180935837328434,
      "mae_dy": 0.00426412234082818,
      "pose_mae_dtheta": 0.21364660561084747,
      "pose_mae_dx": 0.09263337403535843,
      "pose_mae_dy": 0.051353324204683304,
      "pose_rmse_dtheta": 0.40078938007354736,
      "pose_rmse_dx": 0.23192332684993744,
      "pose_rmse_dy": 0.10564808547496796,
      "pose_rmse_mean": 0.24612027406692505,
      "rmse_dtheta": 0.043649472296237946,
      "rmse_dx": 0.023995094001293182,
      "rmse_dy": 0.00820536445826292,
      "rmse_mean": 0.025283310562372208,
      "rotation_flip": 0.013931888155639172,
      "sparse_tokens": 12141.0,
      "step": 11629,
      "turn_loss": 0.24178534746170044,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5403270767515331,
      "grad_norm": 0.46416574716567993,
      "learning_rate": 2.4043977478560575e-08,
      "loss": 0.0995,
      "mae_dtheta": 0.006421232130378485,
      "mae_dx": 0.0014061082620173693,
      "mae_dy": 0.002037670463323593,
      "pose_mae_dtheta": 0.04257980361580849,
      "pose_mae_dx": 0.01700458489358425,
      "pose_mae_dy": 0.020133942365646362,
      "pose_rmse_dtheta": 0.08743973076343536,
      "pose_rmse_dx": 0.04940259829163551,
      "pose_rmse_dy": 0.05308963730931282,
      "pose_rmse_mean": 0.0633106529712677,
      "rmse_dtheta": 0.014266102574765682,
      "rmse_dx": 0.003969668876379728,
      "rmse_dy": 0.005207149777561426,
      "rmse_mean": 0.007814306765794754,
      "rotation_flip": 0.0032206119503825903,
      "sparse_tokens": 32105.0,
      "step": 11630,
      "turn_loss": 0.06009865924715996,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.540373536517376,
      "grad_norm": 0.4231574833393097,
      "learning_rate": 2.3914638320203243e-08,
      "loss": 0.076,
      "mae_dtheta": 0.0054785991087555885,
      "mae_dx": 0.002418848453089595,
      "mae_dy": 0.0012756586074829102,
      "pose_mae_dtheta": 0.03872978314757347,
      "pose_mae_dx": 0.023490924388170242,
      "pose_mae_dy": 0.017220163717865944,
      "pose_rmse_dtheta": 0.0978408083319664,
      "pose_rmse_dx": 0.08626563102006912,
      "pose_rmse_dy": 0.0483626052737236,
      "pose_rmse_mean": 0.0774896889925003,
      "rmse_dtheta": 0.01461025420576334,
      "rmse_dx": 0.008537918329238892,
      "rmse_dy": 0.003368613077327609,
      "rmse_mean": 0.008838928304612637,
      "rotation_flip": 0.004000000189989805,
      "sparse_tokens": 32057.0,
      "step": 11631,
      "turn_loss": 0.06824775785207748,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5404199962832187,
      "grad_norm": 0.5722631216049194,
      "learning_rate": 2.378564714216547e-08,
      "loss": 0.1339,
      "mae_dtheta": 0.010657171718776226,
      "mae_dx": 0.0018494349205866456,
      "mae_dy": 0.002576876198872924,
      "pose_mae_dtheta": 0.06584005057811737,
      "pose_mae_dx": 0.025675136595964432,
      "pose_mae_dy": 0.02986133098602295,
      "pose_rmse_dtheta": 0.11932677775621414,
      "pose_rmse_dx": 0.05656155198812485,
      "pose_rmse_dy": 0.06571409851312637,
      "pose_rmse_mean": 0.08053414523601532,
      "rmse_dtheta": 0.0191196259111166,
      "rmse_dx": 0.004723799414932728,
      "rmse_dy": 0.005021409597247839,
      "rmse_mean": 0.00962161272764206,
      "rotation_flip": 0.006247944664210081,
      "sparse_tokens": 32169.0,
      "step": 11632,
      "turn_loss": 0.10757909715175629,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5404664560490615,
      "grad_norm": 0.41563189029693604,
      "learning_rate": 2.3657003953468926e-08,
      "loss": 0.0876,
      "mae_dtheta": 0.011066913604736328,
      "mae_dx": 0.0016965371323749423,
      "mae_dy": 0.002022475004196167,
      "pose_mae_dtheta": 0.06607498228549957,
      "pose_mae_dx": 0.022377552464604378,
      "pose_mae_dy": 0.02455778606235981,
      "pose_rmse_dtheta": 0.15241819620132446,
      "pose_rmse_dx": 0.06504029780626297,
      "pose_rmse_dy": 0.057076819241046906,
      "pose_rmse_mean": 0.09151177108287811,
      "rmse_dtheta": 0.023300066590309143,
      "rmse_dx": 0.005545229185372591,
      "rmse_dy": 0.00467977998778224,
      "rmse_mean": 0.011175025254487991,
      "rotation_flip": 0.0020790020935237408,
      "sparse_tokens": 32073.0,
      "step": 11633,
      "turn_loss": 0.0857362374663353,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.5405129158149042,
      "grad_norm": 0.7193434238433838,
      "learning_rate": 2.35287087631092e-08,
      "loss": 0.0962,
      "mae_dtheta": 0.009420309215784073,
      "mae_dx": 0.0011253698030486703,
      "mae_dy": 0.00020312215201556683,
      "pose_mae_dtheta": 0.06674507260322571,
      "pose_mae_dx": 0.008494434878230095,
      "pose_mae_dy": 0.0024758027866482735,
      "pose_rmse_dtheta": 0.28876644372940063,
      "pose_rmse_dx": 0.019499177113175392,
      "pose_rmse_dy": 0.0046378537081182,
      "pose_rmse_mean": 0.10430116951465607,
      "rmse_dtheta": 0.03370785340666771,
      "rmse_dx": 0.0031169920694082975,
      "rmse_dy": 0.00047661701682955027,
      "rmse_mean": 0.012433821335434914,
      "rotation_flip": 0.0,
      "sparse_tokens": 32233.0,
      "step": 11634,
      "turn_loss": 0.04843449965119362,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5405593755807471,
      "grad_norm": 0.3948465585708618,
      "learning_rate": 2.3400761580057442e-08,
      "loss": 0.0999,
      "mae_dtheta": 0.007296434603631496,
      "mae_dx": 0.0011540156556293368,
      "mae_dy": 0.0016432765405625105,
      "pose_mae_dtheta": 0.049418848007917404,
      "pose_mae_dx": 0.014684275723993778,
      "pose_mae_dy": 0.020268186926841736,
      "pose_rmse_dtheta": 0.13652148842811584,
      "pose_rmse_dx": 0.0343564935028553,
      "pose_rmse_dy": 0.042406585067510605,
      "pose_rmse_mean": 0.07109485566616058,
      "rmse_dtheta": 0.01949535682797432,
      "rmse_dx": 0.0035700364969670773,
      "rmse_dy": 0.0037233547773212194,
      "rmse_mean": 0.008929583244025707,
      "rotation_flip": 0.0024135157000273466,
      "sparse_tokens": 32105.0,
      "step": 11635,
      "turn_loss": 0.06212272122502327,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5406058353465899,
      "grad_norm": 0.7555790543556213,
      "learning_rate": 2.3273162413262053e-08,
      "loss": 0.2074,
      "mae_dtheta": 0.010571877472102642,
      "mae_dx": 0.00346735748462379,
      "mae_dy": 0.0026873729657381773,
      "pose_mae_dtheta": 0.06339467316865921,
      "pose_mae_dx": 0.034783974289894104,
      "pose_mae_dy": 0.02875019982457161,
      "pose_rmse_dtheta": 0.1297737956047058,
      "pose_rmse_dx": 0.0897267609834671,
      "pose_rmse_dy": 0.06980633735656738,
      "pose_rmse_mean": 0.09643562883138657,
      "rmse_dtheta": 0.020478038117289543,
      "rmse_dx": 0.010267151519656181,
      "rmse_dy": 0.005220017861574888,
      "rmse_mean": 0.011988403275609016,
      "rotation_flip": 0.005315822549164295,
      "sparse_tokens": 32153.0,
      "step": 11636,
      "turn_loss": 0.14434924721717834,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4883.0,
      "epoch": 0.5406522951124326,
      "grad_norm": 0.5312857627868652,
      "learning_rate": 2.3145911271645338e-08,
      "loss": 0.1343,
      "mae_dtheta": 0.023044725880026817,
      "mae_dx": 0.008970577269792557,
      "mae_dy": 0.005185921210795641,
      "pose_mae_dtheta": 0.18172931671142578,
      "pose_mae_dx": 0.08216544985771179,
      "pose_mae_dy": 0.08657404780387878,
      "pose_rmse_dtheta": 0.276287317276001,
      "pose_rmse_dx": 0.2065616399049759,
      "pose_rmse_dy": 0.17636160552501678,
      "pose_rmse_mean": 0.21973685920238495,
      "rmse_dtheta": 0.034907206892967224,
      "rmse_dx": 0.020406313240528107,
      "rmse_dy": 0.008486233651638031,
      "rmse_mean": 0.02126658521592617,
      "rotation_flip": 0.008658008649945259,
      "sparse_tokens": 4075.0,
      "step": 11637,
      "turn_loss": 0.17182788252830505,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 21679.0,
      "epoch": 0.5406987548782755,
      "grad_norm": 0.683681845664978,
      "learning_rate": 2.301900816410574e-08,
      "loss": 0.1879,
      "mae_dtheta": 0.041002560406923294,
      "mae_dx": 0.014976360835134983,
      "mae_dy": 0.0074536907486617565,
      "pose_mae_dtheta": 0.31997963786125183,
      "pose_mae_dx": 0.12371179461479187,
      "pose_mae_dy": 0.06339912861585617,
      "pose_rmse_dtheta": 0.5268607139587402,
      "pose_rmse_dx": 0.2409304976463318,
      "pose_rmse_dy": 0.16308805346488953,
      "pose_rmse_mean": 0.3102930784225464,
      "rmse_dtheta": 0.05826525017619133,
      "rmse_dx": 0.02690856158733368,
      "rmse_dy": 0.0182761549949646,
      "rmse_mean": 0.034483324736356735,
      "rotation_flip": 0.014548981562256813,
      "sparse_tokens": 16172.0,
      "step": 11638,
      "turn_loss": 0.4029698073863983,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.5407452146441182,
      "grad_norm": 0.5890186429023743,
      "learning_rate": 2.289245309951893e-08,
      "loss": 0.1575,
      "mae_dtheta": 0.04257527366280556,
      "mae_dx": 0.015560037456452847,
      "mae_dy": 0.0037739442195743322,
      "pose_mae_dtheta": 0.33231499791145325,
      "pose_mae_dx": 0.11715148389339447,
      "pose_mae_dy": 0.05178489908576012,
      "pose_rmse_dtheta": 0.5740402936935425,
      "pose_rmse_dx": 0.2437150925397873,
      "pose_rmse_dy": 0.12069579213857651,
      "pose_rmse_mean": 0.3128170669078827,
      "rmse_dtheta": 0.0604817159473896,
      "rmse_dx": 0.028982482850551605,
      "rmse_dy": 0.0073171816766262054,
      "rmse_mean": 0.032260462641716,
      "rotation_flip": 0.011194029822945595,
      "sparse_tokens": 9554.0,
      "step": 11639,
      "turn_loss": 0.30245888233184814,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 32662.0,
      "epoch": 0.540791674409961,
      "grad_norm": 0.5763195157051086,
      "learning_rate": 2.2766246086733946e-08,
      "loss": 0.1841,
      "mae_dtheta": 0.03321342170238495,
      "mae_dx": 0.013723711483180523,
      "mae_dy": 0.0058920374140143394,
      "pose_mae_dtheta": 0.26523730158805847,
      "pose_mae_dx": 0.10586445778608322,
      "pose_mae_dy": 0.064424529671669,
      "pose_rmse_dtheta": 0.4549654424190521,
      "pose_rmse_dx": 0.22051087021827698,
      "pose_rmse_dy": 0.14387018978595734,
      "pose_rmse_mean": 0.27311551570892334,
      "rmse_dtheta": 0.05053912103176117,
      "rmse_dx": 0.0265987329185009,
      "rmse_dy": 0.012482810765504837,
      "rmse_mean": 0.029873555526137352,
      "rotation_flip": 0.008569545112550259,
      "sparse_tokens": 26751.0,
      "step": 11640,
      "turn_loss": 0.3144506812095642,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5408381341758037,
      "grad_norm": 0.5587950944900513,
      "learning_rate": 2.264038713457706e-08,
      "loss": 0.1005,
      "mae_dtheta": 0.007055837195366621,
      "mae_dx": 0.0015043726889416575,
      "mae_dy": 0.0015147373778745532,
      "pose_mae_dtheta": 0.047847770154476166,
      "pose_mae_dx": 0.017637671902775764,
      "pose_mae_dy": 0.01692620851099491,
      "pose_rmse_dtheta": 0.13110268115997314,
      "pose_rmse_dx": 0.05619565770030022,
      "pose_rmse_dy": 0.05026870593428612,
      "pose_rmse_mean": 0.07918901741504669,
      "rmse_dtheta": 0.01639721170067787,
      "rmse_dx": 0.004568784963339567,
      "rmse_dy": 0.004624516237527132,
      "rmse_mean": 0.00853017158806324,
      "rotation_flip": 0.0015026296023279428,
      "sparse_tokens": 32169.0,
      "step": 11641,
      "turn_loss": 0.06576379388570786,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16834.0,
      "epoch": 0.5408845939416466,
      "grad_norm": 0.5598311424255371,
      "learning_rate": 2.2514876251849005e-08,
      "loss": 0.1605,
      "mae_dtheta": 0.040075335651636124,
      "mae_dx": 0.015358595177531242,
      "mae_dy": 0.003941112197935581,
      "pose_mae_dtheta": 0.34884050488471985,
      "pose_mae_dx": 0.11288931965827942,
      "pose_mae_dy": 0.05968673154711723,
      "pose_rmse_dtheta": 0.5941659212112427,
      "pose_rmse_dx": 0.23629580438137054,
      "pose_rmse_dy": 0.1690683513879776,
      "pose_rmse_mean": 0.33317670226097107,
      "rmse_dtheta": 0.060575783252716064,
      "rmse_dx": 0.028161069378256798,
      "rmse_dy": 0.007554018869996071,
      "rmse_mean": 0.03209695965051651,
      "rotation_flip": 0.007100591901689768,
      "sparse_tokens": 13457.0,
      "step": 11642,
      "turn_loss": 0.2411731332540512,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5409310537074893,
      "grad_norm": 0.5686880350112915,
      "learning_rate": 2.2389713447327766e-08,
      "loss": 0.1601,
      "mae_dtheta": 0.01254170760512352,
      "mae_dx": 0.004453230183571577,
      "mae_dy": 0.003144078655168414,
      "pose_mae_dtheta": 0.08362085372209549,
      "pose_mae_dx": 0.0411049909889698,
      "pose_mae_dy": 0.037735626101493835,
      "pose_rmse_dtheta": 0.170307919383049,
      "pose_rmse_dx": 0.1276504546403885,
      "pose_rmse_dy": 0.11015809327363968,
      "pose_rmse_mean": 0.13603882491588593,
      "rmse_dtheta": 0.024107176810503006,
      "rmse_dx": 0.013950775377452374,
      "rmse_dy": 0.008934985846281052,
      "rmse_mean": 0.01566431298851967,
      "rotation_flip": 0.007870370522141457,
      "sparse_tokens": 32041.0,
      "step": 11643,
      "turn_loss": 0.1497027426958084,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5409775134733321,
      "grad_norm": 0.5765514373779297,
      "learning_rate": 2.2264898729765228e-08,
      "loss": 0.1482,
      "mae_dtheta": 0.018072910606861115,
      "mae_dx": 0.004911417607218027,
      "mae_dy": 0.006477509159594774,
      "pose_mae_dtheta": 0.1301708221435547,
      "pose_mae_dx": 0.05624086782336235,
      "pose_mae_dy": 0.052502721548080444,
      "pose_rmse_dtheta": 0.24109040200710297,
      "pose_rmse_dx": 0.13058823347091675,
      "pose_rmse_dy": 0.10271148383617401,
      "pose_rmse_mean": 0.15813004970550537,
      "rmse_dtheta": 0.03211349993944168,
      "rmse_dx": 0.01109091006219387,
      "rmse_dy": 0.01339768711477518,
      "rmse_mean": 0.018867366015911102,
      "rotation_flip": 0.01068050041794777,
      "sparse_tokens": 32153.0,
      "step": 11644,
      "turn_loss": 0.19234490394592285,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12675.0,
      "epoch": 0.5410239732391748,
      "grad_norm": 0.45177099108695984,
      "learning_rate": 2.2140432107889965e-08,
      "loss": 0.113,
      "mae_dtheta": 0.028840743005275726,
      "mae_dx": 0.010259941220283508,
      "mae_dy": 0.0033364424016326666,
      "pose_mae_dtheta": 0.207691490650177,
      "pose_mae_dx": 0.09412691742181778,
      "pose_mae_dy": 0.0439622700214386,
      "pose_rmse_dtheta": 0.3985205888748169,
      "pose_rmse_dx": 0.21437285840511322,
      "pose_rmse_dy": 0.12468137592077255,
      "pose_rmse_mean": 0.24585828185081482,
      "rmse_dtheta": 0.047451265156269073,
      "rmse_dx": 0.021963389590382576,
      "rmse_dy": 0.007511638570576906,
      "rmse_mean": 0.025642096996307373,
      "rotation_flip": 0.005016722250729799,
      "sparse_tokens": 10478.0,
      "step": 11645,
      "turn_loss": 0.20677487552165985,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5410704330050177,
      "grad_norm": 0.4444023668766022,
      "learning_rate": 2.2016313590406125e-08,
      "loss": 0.0852,
      "mae_dtheta": 0.00962226465344429,
      "mae_dx": 0.0024265022948384285,
      "mae_dy": 0.003839827375486493,
      "pose_mae_dtheta": 0.06541084498167038,
      "pose_mae_dx": 0.027017533779144287,
      "pose_mae_dy": 0.03160029277205467,
      "pose_rmse_dtheta": 0.13137975335121155,
      "pose_rmse_dx": 0.07913848757743835,
      "pose_rmse_dy": 0.06531142443418503,
      "pose_rmse_mean": 0.09194322675466537,
      "rmse_dtheta": 0.017953965812921524,
      "rmse_dx": 0.005996876861900091,
      "rmse_dy": 0.007969378493726254,
      "rmse_mean": 0.01064007356762886,
      "rotation_flip": 0.005321035627275705,
      "sparse_tokens": 32089.0,
      "step": 11646,
      "turn_loss": 0.10559197515249252,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5411168927708604,
      "grad_norm": 0.5465507507324219,
      "learning_rate": 2.189254318599343e-08,
      "loss": 0.1068,
      "mae_dtheta": 0.009486249648034573,
      "mae_dx": 0.0024862459395080805,
      "mae_dy": 0.0020591181237250566,
      "pose_mae_dtheta": 0.06331492215394974,
      "pose_mae_dx": 0.023767895996570587,
      "pose_mae_dy": 0.02074524387717247,
      "pose_rmse_dtheta": 0.18140321969985962,
      "pose_rmse_dx": 0.06645894050598145,
      "pose_rmse_dy": 0.05665871873497963,
      "pose_rmse_mean": 0.10150696337223053,
      "rmse_dtheta": 0.02260393090546131,
      "rmse_dx": 0.008430153131484985,
      "rmse_dy": 0.005631323903799057,
      "rmse_mean": 0.01222180388867855,
      "rotation_flip": 0.010231317020952702,
      "sparse_tokens": 32089.0,
      "step": 11647,
      "turn_loss": 0.07681417465209961,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5411633525367032,
      "grad_norm": 0.3314562439918518,
      "learning_rate": 2.1769120903307182e-08,
      "loss": 0.0701,
      "mae_dtheta": 0.010773954913020134,
      "mae_dx": 0.002305286005139351,
      "mae_dy": 0.0034119903575628996,
      "pose_mae_dtheta": 0.0719292163848877,
      "pose_mae_dx": 0.03541155904531479,
      "pose_mae_dy": 0.03154383972287178,
      "pose_rmse_dtheta": 0.18407447636127472,
      "pose_rmse_dx": 0.11729627102613449,
      "pose_rmse_dy": 0.09078540652990341,
      "pose_rmse_mean": 0.13071872293949127,
      "rmse_dtheta": 0.023351378738880157,
      "rmse_dx": 0.006754881236702204,
      "rmse_dy": 0.008802979253232479,
      "rmse_mean": 0.012969746254384518,
      "rotation_flip": 0.008300567977130413,
      "sparse_tokens": 32057.0,
      "step": 11648,
      "turn_loss": 0.10169371217489243,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.541209812302546,
      "grad_norm": 0.604881763458252,
      "learning_rate": 2.1646046750978255e-08,
      "loss": 0.1951,
      "mae_dtheta": 0.014902724884450436,
      "mae_dx": 0.0020957093220204115,
      "mae_dy": 0.00426035700365901,
      "pose_mae_dtheta": 0.09909888356924057,
      "pose_mae_dx": 0.03332878276705742,
      "pose_mae_dy": 0.04601048678159714,
      "pose_rmse_dtheta": 0.2332698553800583,
      "pose_rmse_dx": 0.08626529574394226,
      "pose_rmse_dy": 0.1162857785820961,
      "pose_rmse_mean": 0.14527364075183868,
      "rmse_dtheta": 0.02778727561235428,
      "rmse_dx": 0.00540534732863307,
      "rmse_dy": 0.008963605388998985,
      "rmse_mean": 0.014052076265215874,
      "rotation_flip": 0.008074162527918816,
      "sparse_tokens": 32105.0,
      "step": 11649,
      "turn_loss": 0.12687011063098907,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5412562720683888,
      "grad_norm": 0.40255215764045715,
      "learning_rate": 2.1523320737613095e-08,
      "loss": 0.0666,
      "mae_dtheta": 0.006248693447560072,
      "mae_dx": 0.0013062120415270329,
      "mae_dy": 0.0012833155924454331,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.40255221724510193,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 161.38966369628906,
      "model/head/act_norm_mean": 114.3155184659091,
      "model/head/act_norm_min": 63.42350769042969,
      "model/head/act_over_embed": 78.55869452851849,
      "model/head/grad_frac": 0.08346695452928543,
      "model/head/grad_norm": 0.03359980881214142,
      "model/head/grad_zero_frac": 0.00018592126434668899,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7090780855429293,
      "model/head/update_ratio": 0.0005719607579521835,
      "model/head/weight_delta": 9.985966682434082,
      "model/head/weight_delta_rel": 0.17518343031406403,
      "model/head/weight_norm": 58.74495315551758,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42292407155036926,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228657511024993,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42277517914772034,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905973030891733,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09763074666261673,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03930147364735603,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5274851527149321,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012690233998000622,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569132804870605,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314619541168213,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969858169555664,
      "model/modality_embedder/grad_frac": 0.09763074666261673,
      "model/modality_embedder/grad_norm": 0.03930147364735603,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5274851527149321,
      "model/modality_embedder/update_ratio": 0.0012690233998000622,
      "model/modality_embedder/weight_delta": 3.1569132804870605,
      "model/modality_embedder/weight_delta_rel": 0.10314619541168213,
      "model/modality_embedder/weight_norm": 30.969858169555664,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 90.75968170166016,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.974334114959117,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.973347663879395,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.475386855052175,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05396221950650215,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.021722611039876938,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00031270174076780677,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007768826908431947,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7428336143493652,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995051473379135,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96125030517578,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 91.95374298095703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.91730048500882,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.255860328674316,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.12340217274058,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.05526020750403404,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.022245118394494057,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007472088327631354,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4775750637054443,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12046591937541962,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770952224731445,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 93.31929016113281,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.693492464325796,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.24295425415039,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.34401792989851,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.050947126001119614,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02050887793302536,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002773966989479959,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0006671171286143363,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7675669193267822,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12650784850120544,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742544174194336,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 94.13585662841797,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.365304834054832,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.166285514831543,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.492903042130305,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.050729114562273026,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.020421117544174194,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006817087414674461,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.238628387451172,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11068095266819,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955781936645508,
      "model/normalizer/grad_frac": 0.212046816945076,
      "model/normalizer/grad_norm": 0.08535991609096527,
      "model/normalizer/grad_zero_frac": 0.00027770851738750935,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0010852013947442174,
      "model/normalizer/weight_delta": 6.81067419052124,
      "model/normalizer/weight_delta_rel": 0.08771754056215286,
      "model/normalizer/weight_norm": 78.65813446044922,
      "pose_mae_dtheta": 0.040606528520584106,
      "pose_mae_dx": 0.01249937154352665,
      "pose_mae_dy": 0.015784012153744698,
      "pose_rmse_dtheta": 0.11507174372673035,
      "pose_rmse_dx": 0.039519742131233215,
      "pose_rmse_dy": 0.036322515457868576,
      "pose_rmse_mean": 0.06363800168037415,
      "rmse_dtheta": 0.016996415331959724,
      "rmse_dx": 0.004609021823853254,
      "rmse_dy": 0.003118430031463504,
      "rmse_mean": 0.008241289295256138,
      "rotation_flip": 0.0057012541219592094,
      "sparse_tokens": 32089.0,
      "step": 11650,
      "turn_loss": 0.05316464602947235,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.5413027318342316,
      "grad_norm": 0.5071637630462646,
      "learning_rate": 2.1400942871794283e-08,
      "loss": 0.0755,
      "mae_dtheta": 0.027193740010261536,
      "mae_dx": 0.009250963106751442,
      "mae_dy": 0.004596061538904905,
      "pose_mae_dtheta": 0.21539448201656342,
      "pose_mae_dx": 0.07172513753175735,
      "pose_mae_dy": 0.04488430544734001,
      "pose_rmse_dtheta": 0.4167877733707428,
      "pose_rmse_dx": 0.19162611663341522,
      "pose_rmse_dy": 0.11804480105638504,
      "pose_rmse_mean": 0.24215289950370789,
      "rmse_dtheta": 0.04701095074415207,
      "rmse_dx": 0.02154652215540409,
      "rmse_dy": 0.009858876466751099,
      "rmse_mean": 0.026138782501220703,
      "rotation_flip": 0.007263922598212957,
      "sparse_tokens": 8622.0,
      "step": 11651,
      "turn_loss": 0.1555722951889038,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 11020.0,
      "epoch": 0.5413491916000743,
      "grad_norm": 0.3611499071121216,
      "learning_rate": 2.1278913162079973e-08,
      "loss": 0.1065,
      "mae_dtheta": 0.027796821668744087,
      "mae_dx": 0.013576142489910126,
      "mae_dy": 0.007476039696484804,
      "pose_mae_dtheta": 0.21137601137161255,
      "pose_mae_dx": 0.11185874044895172,
      "pose_mae_dy": 0.08630502223968506,
      "pose_rmse_dtheta": 0.3993075489997864,
      "pose_rmse_dx": 0.25825032591819763,
      "pose_rmse_dy": 0.20071204006671906,
      "pose_rmse_mean": 0.2860899567604065,
      "rmse_dtheta": 0.04362167418003082,
      "rmse_dx": 0.02754344418644905,
      "rmse_dy": 0.014347211457788944,
      "rmse_mean": 0.028504109010100365,
      "rotation_flip": 0.01413427572697401,
      "sparse_tokens": 9323.0,
      "step": 11652,
      "turn_loss": 0.2787330746650696,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5413956513659172,
      "grad_norm": 0.3281901776790619,
      "learning_rate": 2.1157231617002783e-08,
      "loss": 0.0969,
      "mae_dtheta": 0.00591379264369607,
      "mae_dx": 0.0010234102373942733,
      "mae_dy": 0.0004074050229974091,
      "pose_mae_dtheta": 0.0406266450881958,
      "pose_mae_dx": 0.007768408395349979,
      "pose_mae_dy": 0.006251514423638582,
      "pose_rmse_dtheta": 0.19258983433246613,
      "pose_rmse_dx": 0.020077409222722054,
      "pose_rmse_dy": 0.022677212953567505,
      "pose_rmse_mean": 0.07844815403223038,
      "rmse_dtheta": 0.02402859553694725,
      "rmse_dx": 0.0032627598848193884,
      "rmse_dy": 0.0011682482436299324,
      "rmse_mean": 0.00948653556406498,
      "rotation_flip": 0.0034934498835355043,
      "sparse_tokens": 32089.0,
      "step": 11653,
      "turn_loss": 0.03904411196708679,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1336.0,
      "epoch": 0.5414421111317599,
      "grad_norm": 0.4112932085990906,
      "learning_rate": 2.103589824507368e-08,
      "loss": 0.0764,
      "mae_dtheta": 0.03996727243065834,
      "mae_dx": 0.029897600412368774,
      "mae_dy": 0.01480711717158556,
      "pose_mae_dtheta": 0.33589228987693787,
      "pose_mae_dx": 0.21067288517951965,
      "pose_mae_dy": 0.17721091210842133,
      "pose_rmse_dtheta": 0.5709565281867981,
      "pose_rmse_dx": 0.4114892780780792,
      "pose_rmse_dy": 0.27450135350227356,
      "pose_rmse_mean": 0.4189823865890503,
      "rmse_dtheta": 0.05578833073377609,
      "rmse_dx": 0.04457312077283859,
      "rmse_dy": 0.019982032477855682,
      "rmse_mean": 0.040114495903253555,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 1236.0,
      "step": 11654,
      "turn_loss": 0.4467517137527466,
      "turns": 4.0,
      "turns_per_sample": 4.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5414885708976027,
      "grad_norm": 0.47857609391212463,
      "learning_rate": 2.0914913054775888e-08,
      "loss": 0.115,
      "mae_dtheta": 0.010136079043149948,
      "mae_dx": 0.0016556495102122426,
      "mae_dy": 0.002031639451161027,
      "pose_mae_dtheta": 0.07063958048820496,
      "pose_mae_dx": 0.02013425901532173,
      "pose_mae_dy": 0.020775081589818,
      "pose_rmse_dtheta": 0.22278322279453278,
      "pose_rmse_dx": 0.06241699308156967,
      "pose_rmse_dy": 0.04569944739341736,
      "pose_rmse_mean": 0.11029988527297974,
      "rmse_dtheta": 0.026069479063153267,
      "rmse_dx": 0.005456168204545975,
      "rmse_dy": 0.00466526672244072,
      "rmse_mean": 0.012063639238476753,
      "rotation_flip": 0.004766031168401241,
      "sparse_tokens": 32089.0,
      "step": 11655,
      "turn_loss": 0.07739375531673431,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5415350306634454,
      "grad_norm": 0.5233467221260071,
      "learning_rate": 2.079427605457096e-08,
      "loss": 0.0779,
      "mae_dtheta": 0.012396386824548244,
      "mae_dx": 0.0018304453697055578,
      "mae_dy": 0.003518126206472516,
      "pose_mae_dtheta": 0.08472822606563568,
      "pose_mae_dx": 0.034435976296663284,
      "pose_mae_dy": 0.04405854269862175,
      "pose_rmse_dtheta": 0.17304149270057678,
      "pose_rmse_dx": 0.09344711154699326,
      "pose_rmse_dy": 0.11096147447824478,
      "pose_rmse_mean": 0.1258167028427124,
      "rmse_dtheta": 0.023377761244773865,
      "rmse_dx": 0.004697947762906551,
      "rmse_dy": 0.007430110592395067,
      "rmse_mean": 0.01183527335524559,
      "rotation_flip": 0.0041269841603934765,
      "sparse_tokens": 32105.0,
      "step": 11656,
      "turn_loss": 0.08765612542629242,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5415814904292883,
      "grad_norm": 0.4600875675678253,
      "learning_rate": 2.0673987252894934e-08,
      "loss": 0.0984,
      "mae_dtheta": 0.00717972731217742,
      "mae_dx": 0.0015338027151301503,
      "mae_dy": 0.0010031670099124312,
      "pose_mae_dtheta": 0.05341615900397301,
      "pose_mae_dx": 0.01251253578811884,
      "pose_mae_dy": 0.011547602713108063,
      "pose_rmse_dtheta": 0.1905018538236618,
      "pose_rmse_dx": 0.05363936349749565,
      "pose_rmse_dy": 0.029498588293790817,
      "pose_rmse_mean": 0.09121327102184296,
      "rmse_dtheta": 0.022313296794891357,
      "rmse_dx": 0.006397021934390068,
      "rmse_dy": 0.0024971202947199345,
      "rmse_mean": 0.010402480140328407,
      "rotation_flip": 0.004739336669445038,
      "sparse_tokens": 32169.0,
      "step": 11657,
      "turn_loss": 0.05365787446498871,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.541627950195131,
      "grad_norm": 0.8439260721206665,
      "learning_rate": 2.055404665815941e-08,
      "loss": 0.1575,
      "mae_dtheta": 0.03110152669250965,
      "mae_dx": 0.009149901568889618,
      "mae_dy": 0.003894336521625519,
      "pose_mae_dtheta": 0.23201142251491547,
      "pose_mae_dx": 0.05472090095281601,
      "pose_mae_dy": 0.027131671085953712,
      "pose_rmse_dtheta": 0.44626176357269287,
      "pose_rmse_dx": 0.12623590230941772,
      "pose_rmse_dy": 0.07527411729097366,
      "pose_rmse_mean": 0.21592393517494202,
      "rmse_dtheta": 0.05242284759879112,
      "rmse_dx": 0.018357178196310997,
      "rmse_dy": 0.009553693234920502,
      "rmse_mean": 0.026777906343340874,
      "rotation_flip": 0.006369426846504211,
      "sparse_tokens": 6094.0,
      "step": 11658,
      "turn_loss": 0.23877042531967163,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5416744099609738,
      "grad_norm": 0.5551822781562805,
      "learning_rate": 2.0434454278752126e-08,
      "loss": 0.1436,
      "mae_dtheta": 0.009372415021061897,
      "mae_dx": 0.0015927766216918826,
      "mae_dy": 0.00178316212259233,
      "pose_mae_dtheta": 0.06584290415048599,
      "pose_mae_dx": 0.019516795873641968,
      "pose_mae_dy": 0.024759504944086075,
      "pose_rmse_dtheta": 0.17588107287883759,
      "pose_rmse_dx": 0.04928513988852501,
      "pose_rmse_dy": 0.057114776223897934,
      "pose_rmse_mean": 0.09409366548061371,
      "rmse_dtheta": 0.021962536498904228,
      "rmse_dx": 0.004949401598423719,
      "rmse_dy": 0.0038292293902486563,
      "rmse_mean": 0.010247056372463703,
      "rotation_flip": 0.0022271715570241213,
      "sparse_tokens": 32089.0,
      "step": 11659,
      "turn_loss": 0.07161130756139755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5417208697268165,
      "grad_norm": 0.5908500552177429,
      "learning_rate": 2.0315210123035835e-08,
      "loss": 0.138,
      "mae_dtheta": 0.007827389985322952,
      "mae_dx": 0.0017498786328360438,
      "mae_dy": 0.0013281875289976597,
      "pose_mae_dtheta": 0.052210766822099686,
      "pose_mae_dx": 0.012890146113932133,
      "pose_mae_dy": 0.01410740241408348,
      "pose_rmse_dtheta": 0.1833251416683197,
      "pose_rmse_dx": 0.029550155624747276,
      "pose_rmse_dy": 0.04027207940816879,
      "pose_rmse_mean": 0.08438245952129364,
      "rmse_dtheta": 0.023895377293229103,
      "rmse_dx": 0.005219351500272751,
      "rmse_dy": 0.004349295981228352,
      "rmse_mean": 0.011154675856232643,
      "rotation_flip": 0.004295532591640949,
      "sparse_tokens": 32185.0,
      "step": 11660,
      "turn_loss": 0.06930449604988098,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.5417673294926594,
      "grad_norm": 0.6398030519485474,
      "learning_rate": 2.0196314199349977e-08,
      "loss": 0.1157,
      "mae_dtheta": 0.020307203754782677,
      "mae_dx": 0.005440934561192989,
      "mae_dy": 0.0032661694567650557,
      "pose_mae_dtheta": 0.14892876148223877,
      "pose_mae_dx": 0.03314930945634842,
      "pose_mae_dy": 0.032788973301649094,
      "pose_rmse_dtheta": 0.3188343644142151,
      "pose_rmse_dx": 0.10886789858341217,
      "pose_rmse_dy": 0.1055133193731308,
      "pose_rmse_mean": 0.17773853242397308,
      "rmse_dtheta": 0.038000475615262985,
      "rmse_dx": 0.014600901864469051,
      "rmse_dy": 0.007356857880949974,
      "rmse_mean": 0.019986078143119812,
      "rotation_flip": 0.004608294926583767,
      "sparse_tokens": 8036.0,
      "step": 11661,
      "turn_loss": 0.15722283720970154,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5418137892585021,
      "grad_norm": 0.3575737774372101,
      "learning_rate": 2.0077766516008456e-08,
      "loss": 0.0774,
      "mae_dtheta": 0.00628851680085063,
      "mae_dx": 0.0011590287322178483,
      "mae_dy": 0.0017077919328585267,
      "pose_mae_dtheta": 0.03875335678458214,
      "pose_mae_dx": 0.016402022913098335,
      "pose_mae_dy": 0.017918750643730164,
      "pose_rmse_dtheta": 0.08238733559846878,
      "pose_rmse_dx": 0.045270681381225586,
      "pose_rmse_dy": 0.04079355672001839,
      "pose_rmse_mean": 0.05615052208304405,
      "rmse_dtheta": 0.01418317947536707,
      "rmse_dx": 0.0035108921583741903,
      "rmse_dy": 0.003748352872207761,
      "rmse_mean": 0.007147475145757198,
      "rotation_flip": 0.0031000885646790266,
      "sparse_tokens": 32073.0,
      "step": 11662,
      "turn_loss": 0.056904081255197525,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5418602490243449,
      "grad_norm": 0.353267103433609,
      "learning_rate": 1.9959567081301868e-08,
      "loss": 0.0778,
      "mae_dtheta": 0.008616592735052109,
      "mae_dx": 0.0010345290647819638,
      "mae_dy": 0.0014703180640935898,
      "pose_mae_dtheta": 0.05909253656864166,
      "pose_mae_dx": 0.014190055429935455,
      "pose_mae_dy": 0.02303130552172661,
      "pose_rmse_dtheta": 0.13045495748519897,
      "pose_rmse_dx": 0.033244479447603226,
      "pose_rmse_dy": 0.0541326068341732,
      "pose_rmse_mean": 0.07261068373918533,
      "rmse_dtheta": 0.0189763605594635,
      "rmse_dx": 0.0034979041665792465,
      "rmse_dy": 0.0027956035919487476,
      "rmse_mean": 0.00842328928411007,
      "rotation_flip": 0.0041050901636481285,
      "sparse_tokens": 32089.0,
      "step": 11663,
      "turn_loss": 0.06306272745132446,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5419067087901877,
      "grad_norm": 0.4809945821762085,
      "learning_rate": 1.9841715903495818e-08,
      "loss": 0.1325,
      "mae_dtheta": 0.012583184987306595,
      "mae_dx": 0.0015363087877631187,
      "mae_dy": 0.0024349361192435026,
      "pose_mae_dtheta": 0.08261095732450485,
      "pose_mae_dx": 0.018496941775083542,
      "pose_mae_dy": 0.027114465832710266,
      "pose_rmse_dtheta": 0.22029107809066772,
      "pose_rmse_dx": 0.046029698103666306,
      "pose_rmse_dy": 0.06261958926916122,
      "pose_rmse_mean": 0.10964678972959518,
      "rmse_dtheta": 0.028853505849838257,
      "rmse_dx": 0.004992860369384289,
      "rmse_dy": 0.006764664314687252,
      "rmse_mean": 0.013537011109292507,
      "rotation_flip": 0.005086071789264679,
      "sparse_tokens": 32089.0,
      "step": 11664,
      "turn_loss": 0.09272284805774689,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16188.0,
      "epoch": 0.5419531685560305,
      "grad_norm": 0.4585999548435211,
      "learning_rate": 1.9724212990830938e-08,
      "loss": 0.1183,
      "mae_dtheta": 0.038333918899297714,
      "mae_dx": 0.010559707880020142,
      "mae_dy": 0.006108435336500406,
      "pose_mae_dtheta": 0.3229641318321228,
      "pose_mae_dx": 0.0833171010017395,
      "pose_mae_dy": 0.05788605660200119,
      "pose_rmse_dtheta": 0.5838916897773743,
      "pose_rmse_dx": 0.204445019364357,
      "pose_rmse_dy": 0.1687505841255188,
      "pose_rmse_mean": 0.3190290927886963,
      "rmse_dtheta": 0.06020599976181984,
      "rmse_dx": 0.02207843028008938,
      "rmse_dy": 0.015537125989794731,
      "rmse_mean": 0.03260718658566475,
      "rotation_flip": 0.009864364750683308,
      "sparse_tokens": 13084.0,
      "step": 11665,
      "turn_loss": 0.28958427906036377,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5419996283218732,
      "grad_norm": 0.5884355902671814,
      "learning_rate": 1.9607058351525655e-08,
      "loss": 0.2056,
      "mae_dtheta": 0.00797339528799057,
      "mae_dx": 0.002118838718160987,
      "mae_dy": 0.0019824309274554253,
      "pose_mae_dtheta": 0.051524266600608826,
      "pose_mae_dx": 0.022084450349211693,
      "pose_mae_dy": 0.02042314037680626,
      "pose_rmse_dtheta": 0.16262756288051605,
      "pose_rmse_dx": 0.05809729918837547,
      "pose_rmse_dy": 0.048229772597551346,
      "pose_rmse_mean": 0.08965154737234116,
      "rmse_dtheta": 0.020263856276869774,
      "rmse_dx": 0.006945446599274874,
      "rmse_dy": 0.005674367770552635,
      "rmse_mean": 0.010961223393678665,
      "rotation_flip": 0.005623721983283758,
      "sparse_tokens": 32041.0,
      "step": 11666,
      "turn_loss": 0.10373089462518692,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.542046088087716,
      "grad_norm": 0.3881372809410095,
      "learning_rate": 1.9490251993771746e-08,
      "loss": 0.091,
      "mae_dtheta": 0.00942960474640131,
      "mae_dx": 0.001167021575383842,
      "mae_dy": 0.002083071507513523,
      "pose_mae_dtheta": 0.06092255190014839,
      "pose_mae_dx": 0.017214445397257805,
      "pose_mae_dy": 0.02632194384932518,
      "pose_rmse_dtheta": 0.14058220386505127,
      "pose_rmse_dx": 0.04065146669745445,
      "pose_rmse_dy": 0.05721757560968399,
      "pose_rmse_mean": 0.0794837474822998,
      "rmse_dtheta": 0.019628003239631653,
      "rmse_dx": 0.003548388835042715,
      "rmse_dy": 0.004038847982883453,
      "rmse_mean": 0.009071746841073036,
      "rotation_flip": 0.0048041390255093575,
      "sparse_tokens": 32073.0,
      "step": 11667,
      "turn_loss": 0.07617603987455368,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5420925478535589,
      "grad_norm": 0.6684002876281738,
      "learning_rate": 1.9373793925737683e-08,
      "loss": 0.1524,
      "mae_dtheta": 0.008115275762975216,
      "mae_dx": 0.0014655102277174592,
      "mae_dy": 0.0016530888387933373,
      "pose_mae_dtheta": 0.055044546723365784,
      "pose_mae_dx": 0.015844913199543953,
      "pose_mae_dy": 0.017361212521791458,
      "pose_rmse_dtheta": 0.16379600763320923,
      "pose_rmse_dx": 0.037039730697870255,
      "pose_rmse_dy": 0.044170454144477844,
      "pose_rmse_mean": 0.08166873455047607,
      "rmse_dtheta": 0.020559759810566902,
      "rmse_dx": 0.004227448254823685,
      "rmse_dy": 0.0041839489713311195,
      "rmse_mean": 0.009657053276896477,
      "rotation_flip": 0.0018504811450839043,
      "sparse_tokens": 32185.0,
      "step": 11668,
      "turn_loss": 0.06732529401779175,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18831.0,
      "epoch": 0.5421390076194016,
      "grad_norm": 0.45583945512771606,
      "learning_rate": 1.9257684155566946e-08,
      "loss": 0.1016,
      "mae_dtheta": 0.034520070999860764,
      "mae_dx": 0.009199948981404305,
      "mae_dy": 0.005928735248744488,
      "pose_mae_dtheta": 0.275005966424942,
      "pose_mae_dx": 0.0739821121096611,
      "pose_mae_dy": 0.06123032420873642,
      "pose_rmse_dtheta": 0.5108051300048828,
      "pose_rmse_dx": 0.16364891827106476,
      "pose_rmse_dy": 0.14712809026241302,
      "pose_rmse_mean": 0.27386072278022766,
      "rmse_dtheta": 0.05485887452960014,
      "rmse_dx": 0.01999637298285961,
      "rmse_dy": 0.01245213858783245,
      "rmse_mean": 0.029102463275194168,
      "rotation_flip": 0.010416666977107525,
      "sparse_tokens": 15401.0,
      "step": 11669,
      "turn_loss": 0.23973935842514038,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 20710.0,
      "epoch": 0.5421854673852444,
      "grad_norm": 0.9907124638557434,
      "learning_rate": 1.9141922691380266e-08,
      "loss": 0.2253,
      "mae_dtheta": 0.02701011300086975,
      "mae_dx": 0.011900905519723892,
      "mae_dy": 0.0030166704673320055,
      "pose_mae_dtheta": 0.2031489610671997,
      "pose_mae_dx": 0.09411969035863876,
      "pose_mae_dy": 0.04067518934607506,
      "pose_rmse_dtheta": 0.4089309573173523,
      "pose_rmse_dx": 0.22167092561721802,
      "pose_rmse_dy": 0.09926236420869827,
      "pose_rmse_mean": 0.2432880848646164,
      "rmse_dtheta": 0.04616642743349075,
      "rmse_dx": 0.024751707911491394,
      "rmse_dy": 0.00608499301597476,
      "rmse_mean": 0.025667710229754448,
      "rotation_flip": 0.013404825702309608,
      "sparse_tokens": 16282.0,
      "step": 11670,
      "turn_loss": 0.18754835426807404,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.5422319271510871,
      "grad_norm": 0.4050506055355072,
      "learning_rate": 1.9026509541272276e-08,
      "loss": 0.0835,
      "mae_dtheta": 0.03530719876289368,
      "mae_dx": 0.007481044624000788,
      "mae_dy": 0.0029402237851172686,
      "pose_mae_dtheta": 0.2767407298088074,
      "pose_mae_dx": 0.059712231159210205,
      "pose_mae_dy": 0.035424381494522095,
      "pose_rmse_dtheta": 0.4472464919090271,
      "pose_rmse_dx": 0.13667680323123932,
      "pose_rmse_dy": 0.07551714777946472,
      "pose_rmse_mean": 0.21981346607208252,
      "rmse_dtheta": 0.053374648094177246,
      "rmse_dx": 0.015398183837532997,
      "rmse_dy": 0.006300029810518026,
      "rmse_mean": 0.025024287402629852,
      "rotation_flip": 0.006535947788506746,
      "sparse_tokens": 5024.0,
      "step": 11671,
      "turn_loss": 0.26095691323280334,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 30494.0,
      "epoch": 0.54227838691693,
      "grad_norm": 0.3993336856365204,
      "learning_rate": 1.891144471331374e-08,
      "loss": 0.1141,
      "mae_dtheta": 0.028879769146442413,
      "mae_dx": 0.009279860183596611,
      "mae_dy": 0.005842778831720352,
      "pose_mae_dtheta": 0.22456306219100952,
      "pose_mae_dx": 0.07035130262374878,
      "pose_mae_dy": 0.06630859524011612,
      "pose_rmse_dtheta": 0.40913569927215576,
      "pose_rmse_dx": 0.1475094109773636,
      "pose_rmse_dy": 0.15957389771938324,
      "pose_rmse_mean": 0.23873966932296753,
      "rmse_dtheta": 0.04567019268870354,
      "rmse_dx": 0.020005015656352043,
      "rmse_dy": 0.011811411008238792,
      "rmse_mean": 0.025828873738646507,
      "rotation_flip": 0.011088010855019093,
      "sparse_tokens": 25400.0,
      "step": 11672,
      "turn_loss": 0.26434996724128723,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5423248466827727,
      "grad_norm": 0.4787887632846832,
      "learning_rate": 1.8796728215551564e-08,
      "loss": 0.0777,
      "mae_dtheta": 0.006822291761636734,
      "mae_dx": 0.0014488851884379983,
      "mae_dy": 0.0012625284725800157,
      "pose_mae_dtheta": 0.04598838835954666,
      "pose_mae_dx": 0.014708825387060642,
      "pose_mae_dy": 0.015970690175890923,
      "pose_rmse_dtheta": 0.12896400690078735,
      "pose_rmse_dx": 0.04724450781941414,
      "pose_rmse_dy": 0.048436522483825684,
      "pose_rmse_mean": 0.07488168030977249,
      "rmse_dtheta": 0.017915915697813034,
      "rmse_dx": 0.0050634765066206455,
      "rmse_dy": 0.003122083144262433,
      "rmse_mean": 0.008700491860508919,
      "rotation_flip": 0.005162622779607773,
      "sparse_tokens": 32121.0,
      "step": 11673,
      "turn_loss": 0.052593573927879333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5423713064486155,
      "grad_norm": 0.5828035473823547,
      "learning_rate": 1.8682360056007652e-08,
      "loss": 0.1231,
      "mae_dtheta": 0.005968778859823942,
      "mae_dx": 0.0007029646658338606,
      "mae_dy": 0.001386525109410286,
      "pose_mae_dtheta": 0.037177156656980515,
      "pose_mae_dx": 0.010467330925166607,
      "pose_mae_dy": 0.01771264523267746,
      "pose_rmse_dtheta": 0.09323582798242569,
      "pose_rmse_dx": 0.027760790660977364,
      "pose_rmse_dy": 0.04752632975578308,
      "pose_rmse_mean": 0.05617431923747063,
      "rmse_dtheta": 0.014579053968191147,
      "rmse_dx": 0.0021241509821265936,
      "rmse_dy": 0.0033459276892244816,
      "rmse_mean": 0.006683044135570526,
      "rotation_flip": 0.003000428667291999,
      "sparse_tokens": 32089.0,
      "step": 11674,
      "turn_loss": 0.04377357289195061,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5424177662144583,
      "grad_norm": 0.4428142011165619,
      "learning_rate": 1.8568340242680062e-08,
      "loss": 0.0858,
      "mae_dtheta": 0.008950630202889442,
      "mae_dx": 0.001243910868652165,
      "mae_dy": 0.001710900105535984,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4428141713142395,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 147.722900390625,
      "model/head/act_norm_mean": 109.4380129419192,
      "model/head/act_norm_min": 66.35215759277344,
      "model/head/act_over_embed": 75.20682706850647,
      "model/head/grad_frac": 0.09640183299779892,
      "model/head/grad_norm": 0.042688097804784775,
      "model/head/grad_zero_frac": 0.00020146757015027106,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7023358585858586,
      "model/head/update_ratio": 0.0007266682223416865,
      "model/head/weight_delta": 9.986001014709473,
      "model/head/weight_delta_rel": 0.17518404126167297,
      "model/head/weight_norm": 58.74496078491211,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42293596267700195,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42286999194653,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227900207042694,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2906002174368946,
      "model/modality_embedder.encoders.pose/grad_frac": 0.09327169507741928,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04130202904343605,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5314867424242424,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013336201664060354,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569223403930664,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.103146493434906,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969860076904297,
      "model/modality_embedder/grad_frac": 0.09327169507741928,
      "model/modality_embedder/grad_norm": 0.04130202904343605,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5314867424242424,
      "model/modality_embedder/update_ratio": 0.0013336201664060354,
      "model/modality_embedder/weight_delta": 3.1569223403930664,
      "model/modality_embedder/weight_delta_rel": 0.103146493434906,
      "model/modality_embedder/weight_norm": 30.969860076904297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 81.95963287353516,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.578523328523328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.045547485351562,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.203381976974537,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.04991839453577995,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.022104572504758835,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003379196277819574,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007905429229140282,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.742854595184326,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995127469301224,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96125602722168,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 83.7756576538086,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.567653218694886,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.432598114013672,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.88312129788036,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.051129549741744995,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.022640889510512352,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007605025311931968,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4776031970977783,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12046689540147781,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770959854125977,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 85.6321029663086,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.377552809844477,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.734758377075195,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.1269012414653,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.051758572459220886,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.02291942946612835,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007455279701389372,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7675998210906982,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1265089511871338,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.7425479888916,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 86.44364929199219,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.061041967291967,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.257573127746582,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.283810751537025,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.047176260501146317,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.020890315994620323,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006973716081120074,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2386608123779297,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11068205535411835,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955787658691406,
      "model/normalizer/grad_frac": 0.16297081112861633,
      "model/normalizer/grad_norm": 0.07216578722000122,
      "model/normalizer/grad_zero_frac": 0.00024343811674043536,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.000917461235076189,
      "model/normalizer/weight_delta": 6.810732841491699,
      "model/normalizer/weight_delta_rel": 0.08771829307079315,
      "model/normalizer/weight_norm": 78.65813446044922,
      "pose_mae_dtheta": 0.0594419464468956,
      "pose_mae_dx": 0.012760726734995842,
      "pose_mae_dy": 0.019952017813920975,
      "pose_rmse_dtheta": 0.17322076857089996,
      "pose_rmse_dx": 0.030429763719439507,
      "pose_rmse_dy": 0.046735815703868866,
      "pose_rmse_mean": 0.08346211910247803,
      "rmse_dtheta": 0.02228417433798313,
      "rmse_dx": 0.003519747406244278,
      "rmse_dy": 0.004132344387471676,
      "rmse_mean": 0.009978755377233028,
      "rotation_flip": 0.0069578662514686584,
      "sparse_tokens": 32169.0,
      "step": 11675,
      "turn_loss": 0.07722898572683334,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 23366.0,
      "epoch": 0.5424642259803011,
      "grad_norm": 0.9660921692848206,
      "learning_rate": 1.8454668783542407e-08,
      "loss": 0.2628,
      "mae_dtheta": 0.035401519387960434,
      "mae_dx": 0.016079459339380264,
      "mae_dy": 0.007107309065759182,
      "pose_mae_dtheta": 0.255249947309494,
      "pose_mae_dx": 0.1220056340098381,
      "pose_mae_dy": 0.08430269360542297,
      "pose_rmse_dtheta": 0.4067886173725128,
      "pose_rmse_dx": 0.2508375644683838,
      "pose_rmse_dy": 0.19035570323467255,
      "pose_rmse_mean": 0.2826606333255768,
      "rmse_dtheta": 0.050106678158044815,
      "rmse_dx": 0.029715660959482193,
      "rmse_dy": 0.01342421118170023,
      "rmse_mean": 0.031082183122634888,
      "rotation_flip": 0.015189873054623604,
      "sparse_tokens": 18229.0,
      "step": 11676,
      "turn_loss": 0.3267659544944763,
      "turns": 72.0,
      "turns_per_sample": 72.0
    },
    {
      "dense_tokens": 6175.0,
      "epoch": 0.5425106857461438,
      "grad_norm": 0.5523506999015808,
      "learning_rate": 1.834134568654333e-08,
      "loss": 0.1458,
      "mae_dtheta": 0.047174420207738876,
      "mae_dx": 0.019138338044285774,
      "mae_dy": 0.003339331829920411,
      "pose_mae_dtheta": 0.376431405544281,
      "pose_mae_dx": 0.160460963845253,
      "pose_mae_dy": 0.05020308494567871,
      "pose_rmse_dtheta": 0.6272966861724854,
      "pose_rmse_dx": 0.3024665117263794,
      "pose_rmse_dy": 0.10765966027975082,
      "pose_rmse_mean": 0.34580764174461365,
      "rmse_dtheta": 0.06629296392202377,
      "rmse_dx": 0.03207419440150261,
      "rmse_dy": 0.0066881487146019936,
      "rmse_mean": 0.0350184366106987,
      "rotation_flip": 0.021806852892041206,
      "sparse_tokens": 4541.0,
      "step": 11677,
      "turn_loss": 0.23950712382793427,
      "turns": 19.0,
      "turns_per_sample": 19.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.5425571455119866,
      "grad_norm": 0.40870869159698486,
      "learning_rate": 1.822837095960761e-08,
      "loss": 0.0716,
      "mae_dtheta": 0.030756540596485138,
      "mae_dx": 0.012086856178939342,
      "mae_dy": 0.0024199283216148615,
      "pose_mae_dtheta": 0.19635441899299622,
      "pose_mae_dx": 0.09132932871580124,
      "pose_mae_dy": 0.024733465164899826,
      "pose_rmse_dtheta": 0.3845670223236084,
      "pose_rmse_dx": 0.23452718555927277,
      "pose_rmse_dy": 0.07662792503833771,
      "pose_rmse_mean": 0.23190736770629883,
      "rmse_dtheta": 0.050571925938129425,
      "rmse_dx": 0.025500137358903885,
      "rmse_dy": 0.005548663903027773,
      "rmse_mean": 0.027206910774111748,
      "rotation_flip": 0.00920245423913002,
      "sparse_tokens": 6690.0,
      "step": 11678,
      "turn_loss": 0.1722429245710373,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.5426036052778294,
      "grad_norm": 0.40213489532470703,
      "learning_rate": 1.8115744610635587e-08,
      "loss": 0.0793,
      "mae_dtheta": 0.007559726946055889,
      "mae_dx": 0.0010198666714131832,
      "mae_dy": 0.0002111946523655206,
      "pose_mae_dtheta": 0.057968396693468094,
      "pose_mae_dx": 0.0075554694049060345,
      "pose_mae_dy": 0.0027127496432513,
      "pose_rmse_dtheta": 0.27923163771629333,
      "pose_rmse_dx": 0.0273789893835783,
      "pose_rmse_dy": 0.004963497165590525,
      "pose_rmse_mean": 0.10385803878307343,
      "rmse_dtheta": 0.030722498893737793,
      "rmse_dx": 0.003347857389599085,
      "rmse_dy": 0.0005090029444545507,
      "rmse_mean": 0.01152645330876112,
      "rotation_flip": 0.0026613438967615366,
      "sparse_tokens": 32201.0,
      "step": 11679,
      "turn_loss": 0.03561294823884964,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5426500650436722,
      "grad_norm": 0.3728553354740143,
      "learning_rate": 1.800346664750374e-08,
      "loss": 0.0809,
      "mae_dtheta": 0.009970953688025475,
      "mae_dx": 0.0014118978288024664,
      "mae_dy": 0.002467147074639797,
      "pose_mae_dtheta": 0.06793629378080368,
      "pose_mae_dx": 0.018247930333018303,
      "pose_mae_dy": 0.023497194051742554,
      "pose_rmse_dtheta": 0.20088094472885132,
      "pose_rmse_dx": 0.047337211668491364,
      "pose_rmse_dy": 0.05457543581724167,
      "pose_rmse_mean": 0.10093119740486145,
      "rmse_dtheta": 0.023948926478624344,
      "rmse_dx": 0.004059167578816414,
      "rmse_dy": 0.006623792462050915,
      "rmse_mean": 0.01154396217316389,
      "rotation_flip": 0.003021148033440113,
      "sparse_tokens": 32105.0,
      "step": 11680,
      "turn_loss": 0.08395540714263916,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5426965248095149,
      "grad_norm": 0.4980791211128235,
      "learning_rate": 1.789153707806357e-08,
      "loss": 0.1479,
      "mae_dtheta": 0.013194531202316284,
      "mae_dx": 0.004866430535912514,
      "mae_dy": 0.006600864697247744,
      "pose_mae_dtheta": 0.09382349997758865,
      "pose_mae_dx": 0.05883261561393738,
      "pose_mae_dy": 0.04478536173701286,
      "pose_rmse_dtheta": 0.20786526799201965,
      "pose_rmse_dx": 0.13289876282215118,
      "pose_rmse_dy": 0.08748233318328857,
      "pose_rmse_mean": 0.14274880290031433,
      "rmse_dtheta": 0.025576945394277573,
      "rmse_dx": 0.010759103111922741,
      "rmse_dy": 0.01351865567266941,
      "rmse_mean": 0.016618235036730766,
      "rotation_flip": 0.007431629113852978,
      "sparse_tokens": 32137.0,
      "step": 11681,
      "turn_loss": 0.17408967018127441,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.5427429845753577,
      "grad_norm": 0.4616471529006958,
      "learning_rate": 1.7779955910142143e-08,
      "loss": 0.0943,
      "mae_dtheta": 0.03291601687669754,
      "mae_dx": 0.008531542494893074,
      "mae_dy": 0.003584428457543254,
      "pose_mae_dtheta": 0.28611961007118225,
      "pose_mae_dx": 0.07768850773572922,
      "pose_mae_dy": 0.04684115946292877,
      "pose_rmse_dtheta": 0.523984968662262,
      "pose_rmse_dx": 0.19125515222549438,
      "pose_rmse_dy": 0.10184036940336227,
      "pose_rmse_mean": 0.2723601758480072,
      "rmse_dtheta": 0.050983186811208725,
      "rmse_dx": 0.020314954221248627,
      "rmse_dy": 0.006151072680950165,
      "rmse_mean": 0.025816403329372406,
      "rotation_flip": 0.008333333767950535,
      "sparse_tokens": 5908.0,
      "step": 11682,
      "turn_loss": 0.24804748594760895,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5427894443412005,
      "grad_norm": 0.43559712171554565,
      "learning_rate": 1.7668723151542667e-08,
      "loss": 0.1169,
      "mae_dtheta": 0.009356525726616383,
      "mae_dx": 0.001583123579621315,
      "mae_dy": 0.0019295172533020377,
      "pose_mae_dtheta": 0.06357121467590332,
      "pose_mae_dx": 0.016186518594622612,
      "pose_mae_dy": 0.01810217835009098,
      "pose_rmse_dtheta": 0.19049645960330963,
      "pose_rmse_dx": 0.040048740804195404,
      "pose_rmse_dy": 0.04612232372164726,
      "pose_rmse_mean": 0.09222250431776047,
      "rmse_dtheta": 0.023114845156669617,
      "rmse_dx": 0.0043474044650793076,
      "rmse_dy": 0.005036374554038048,
      "rmse_mean": 0.010832875035703182,
      "rotation_flip": 0.004133939743041992,
      "sparse_tokens": 32169.0,
      "step": 11683,
      "turn_loss": 0.07273704558610916,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.5428359041070433,
      "grad_norm": 0.4421405494213104,
      "learning_rate": 1.7557838810043358e-08,
      "loss": 0.0946,
      "mae_dtheta": 0.009152038022875786,
      "mae_dx": 0.0012366415467113256,
      "mae_dy": 0.0002068712783511728,
      "pose_mae_dtheta": 0.06597604602575302,
      "pose_mae_dx": 0.008712983690202236,
      "pose_mae_dy": 0.002346031367778778,
      "pose_rmse_dtheta": 0.2840374708175659,
      "pose_rmse_dx": 0.019290190190076828,
      "pose_rmse_dy": 0.004662720486521721,
      "pose_rmse_mean": 0.10266345739364624,
      "rmse_dtheta": 0.03300159424543381,
      "rmse_dx": 0.0034574721939861774,
      "rmse_dy": 0.0005120509886182845,
      "rmse_mean": 0.012323706410825253,
      "rotation_flip": 0.0022611645981669426,
      "sparse_tokens": 32233.0,
      "step": 11684,
      "turn_loss": 0.04100082442164421,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.5428823638728861,
      "grad_norm": 0.5791740417480469,
      "learning_rate": 1.7447302893398576e-08,
      "loss": 0.1401,
      "mae_dtheta": 0.039489664137363434,
      "mae_dx": 0.013520431704819202,
      "mae_dy": 0.007715905085206032,
      "pose_mae_dtheta": 0.33199700713157654,
      "pose_mae_dx": 0.11802782118320465,
      "pose_mae_dy": 0.07575448602437973,
      "pose_rmse_dtheta": 0.5995492339134216,
      "pose_rmse_dx": 0.2417905032634735,
      "pose_rmse_dy": 0.1955631673336029,
      "pose_rmse_mean": 0.3456343114376068,
      "rmse_dtheta": 0.058484919369220734,
      "rmse_dx": 0.02478247694671154,
      "rmse_dy": 0.01694474183022976,
      "rmse_mean": 0.03340404853224754,
      "rotation_flip": 0.01173020526766777,
      "sparse_tokens": 12812.0,
      "step": 11685,
      "turn_loss": 0.2955916225910187,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5429288236387289,
      "grad_norm": 0.42411819100379944,
      "learning_rate": 1.7337115409338246e-08,
      "loss": 0.0889,
      "mae_dtheta": 0.008810414001345634,
      "mae_dx": 0.0014603582676500082,
      "mae_dy": 0.0023043539840728045,
      "pose_mae_dtheta": 0.05823533236980438,
      "pose_mae_dx": 0.020629610866308212,
      "pose_mae_dy": 0.023571467027068138,
      "pose_rmse_dtheta": 0.1550905555486679,
      "pose_rmse_dx": 0.05900923162698746,
      "pose_rmse_dy": 0.055560775101184845,
      "pose_rmse_mean": 0.0898868590593338,
      "rmse_dtheta": 0.02130516991019249,
      "rmse_dx": 0.004197319038212299,
      "rmse_dy": 0.0057158926501870155,
      "rmse_mean": 0.010406127199530602,
      "rotation_flip": 0.0030326005071401596,
      "sparse_tokens": 32105.0,
      "step": 11686,
      "turn_loss": 0.0690753161907196,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17534.0,
      "epoch": 0.5429752834045717,
      "grad_norm": 0.527027428150177,
      "learning_rate": 1.7227276365568423e-08,
      "loss": 0.0992,
      "mae_dtheta": 0.02546577714383602,
      "mae_dx": 0.008057857863605022,
      "mae_dy": 0.00528812687844038,
      "pose_mae_dtheta": 0.1845429241657257,
      "pose_mae_dx": 0.07040571421384811,
      "pose_mae_dy": 0.06297033280134201,
      "pose_rmse_dtheta": 0.4007122218608856,
      "pose_rmse_dx": 0.16562727093696594,
      "pose_rmse_dy": 0.1516450047492981,
      "pose_rmse_mean": 0.23932817578315735,
      "rmse_dtheta": 0.045997653156518936,
      "rmse_dx": 0.019642986357212067,
      "rmse_dy": 0.011252209544181824,
      "rmse_mean": 0.025630950927734375,
      "rotation_flip": 0.005494505632668734,
      "sparse_tokens": 14599.0,
      "step": 11687,
      "turn_loss": 0.214238703250885,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5430217431704144,
      "grad_norm": 0.3658255338668823,
      "learning_rate": 1.711778576976908e-08,
      "loss": 0.0711,
      "mae_dtheta": 0.008690192364156246,
      "mae_dx": 0.003220259677618742,
      "mae_dy": 0.0015411467757076025,
      "pose_mae_dtheta": 0.06744690239429474,
      "pose_mae_dx": 0.03434646874666214,
      "pose_mae_dy": 0.02745158039033413,
      "pose_rmse_dtheta": 0.14946778118610382,
      "pose_rmse_dx": 0.09690317511558533,
      "pose_rmse_dy": 0.06630405783653259,
      "pose_rmse_mean": 0.10422500222921371,
      "rmse_dtheta": 0.019879039376974106,
      "rmse_dx": 0.01031614001840353,
      "rmse_dy": 0.0034772679209709167,
      "rmse_mean": 0.011224149726331234,
      "rotation_flip": 0.0017251294339075685,
      "sparse_tokens": 32057.0,
      "step": 11688,
      "turn_loss": 0.08224805444478989,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24663.0,
      "epoch": 0.5430682029362572,
      "grad_norm": 0.4375017583370209,
      "learning_rate": 1.7008643629596866e-08,
      "loss": 0.1209,
      "mae_dtheta": 0.03281981498003006,
      "mae_dx": 0.00992592889815569,
      "mae_dy": 0.004467462655156851,
      "pose_mae_dtheta": 0.2634882926940918,
      "pose_mae_dx": 0.0805165022611618,
      "pose_mae_dy": 0.054689086973667145,
      "pose_rmse_dtheta": 0.47527384757995605,
      "pose_rmse_dx": 0.19620060920715332,
      "pose_rmse_dy": 0.14237944781780243,
      "pose_rmse_mean": 0.27128463983535767,
      "rmse_dtheta": 0.05180108919739723,
      "rmse_dx": 0.02255726419389248,
      "rmse_dy": 0.010021247901022434,
      "rmse_mean": 0.028126534074544907,
      "rotation_flip": 0.005309734493494034,
      "sparse_tokens": 18556.0,
      "step": 11689,
      "turn_loss": 0.23841480910778046,
      "turns": 76.0,
      "turns_per_sample": 76.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5431146627021,
      "grad_norm": 0.3276645541191101,
      "learning_rate": 1.6899849952685677e-08,
      "loss": 0.0876,
      "mae_dtheta": 0.008549974299967289,
      "mae_dx": 0.0019399897428229451,
      "mae_dy": 0.002422593766823411,
      "pose_mae_dtheta": 0.05680408701300621,
      "pose_mae_dx": 0.023002296686172485,
      "pose_mae_dy": 0.0172868724912405,
      "pose_rmse_dtheta": 0.18357522785663605,
      "pose_rmse_dx": 0.06387941539287567,
      "pose_rmse_dy": 0.04568008333444595,
      "pose_rmse_mean": 0.09771157801151276,
      "rmse_dtheta": 0.023922525346279144,
      "rmse_dx": 0.005306994542479515,
      "rmse_dy": 0.006851686630398035,
      "rmse_mean": 0.012027068994939327,
      "rotation_flip": 0.005524862091988325,
      "sparse_tokens": 32153.0,
      "step": 11690,
      "turn_loss": 0.07197477668523788,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5431611224679428,
      "grad_norm": 0.5045807361602783,
      "learning_rate": 1.6791404746642203e-08,
      "loss": 0.1339,
      "mae_dtheta": 0.013968204148113728,
      "mae_dx": 0.0016574487090110779,
      "mae_dy": 0.0018901003058999777,
      "pose_mae_dtheta": 0.09366689622402191,
      "pose_mae_dx": 0.020433636382222176,
      "pose_mae_dy": 0.023225272074341774,
      "pose_rmse_dtheta": 0.2752007842063904,
      "pose_rmse_dx": 0.057120077311992645,
      "pose_rmse_dy": 0.06561315059661865,
      "pose_rmse_mean": 0.1326446831226349,
      "rmse_dtheta": 0.03382526710629463,
      "rmse_dx": 0.004898758139461279,
      "rmse_dy": 0.004808677826076746,
      "rmse_mean": 0.014510901644825935,
      "rotation_flip": 0.0031434185802936554,
      "sparse_tokens": 32137.0,
      "step": 11691,
      "turn_loss": 0.09974940121173859,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5432075822337855,
      "grad_norm": 0.43619731068611145,
      "learning_rate": 1.668330801905038e-08,
      "loss": 0.1072,
      "mae_dtheta": 0.010637544095516205,
      "mae_dx": 0.0022641224786639214,
      "mae_dy": 0.0024658632464706898,
      "pose_mae_dtheta": 0.08249680697917938,
      "pose_mae_dx": 0.019808951765298843,
      "pose_mae_dy": 0.022087018936872482,
      "pose_rmse_dtheta": 0.23446568846702576,
      "pose_rmse_dx": 0.058084823191165924,
      "pose_rmse_dy": 0.05247921869158745,
      "pose_rmse_mean": 0.11500990390777588,
      "rmse_dtheta": 0.027432342991232872,
      "rmse_dx": 0.007398584391921759,
      "rmse_dy": 0.007812571711838245,
      "rmse_mean": 0.014214499853551388,
      "rotation_flip": 0.005877034272998571,
      "sparse_tokens": 32121.0,
      "step": 11692,
      "turn_loss": 0.09872543811798096,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.5432540419996283,
      "grad_norm": 0.5021741986274719,
      "learning_rate": 1.657555977746972e-08,
      "loss": 0.1257,
      "mae_dtheta": 0.02825649455189705,
      "mae_dx": 0.010283896699547768,
      "mae_dy": 0.007525315508246422,
      "pose_mae_dtheta": 0.21878018975257874,
      "pose_mae_dx": 0.10123563557863235,
      "pose_mae_dy": 0.11719058454036713,
      "pose_rmse_dtheta": 0.3915022015571594,
      "pose_rmse_dx": 0.2227468639612198,
      "pose_rmse_dy": 0.23174454271793365,
      "pose_rmse_mean": 0.2819978594779968,
      "rmse_dtheta": 0.04270876199007034,
      "rmse_dx": 0.022564828395843506,
      "rmse_dy": 0.01355410274118185,
      "rmse_mean": 0.02627589926123619,
      "rotation_flip": 0.020477816462516785,
      "sparse_tokens": 6682.0,
      "step": 11693,
      "turn_loss": 0.24230849742889404,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.5433005017654711,
      "grad_norm": 0.8964704275131226,
      "learning_rate": 1.6468160029434743e-08,
      "loss": 0.2901,
      "mae_dtheta": 0.050071414560079575,
      "mae_dx": 0.016046080738306046,
      "mae_dy": 0.008849388919770718,
      "pose_mae_dtheta": 0.4318135380744934,
      "pose_mae_dx": 0.13194230198860168,
      "pose_mae_dy": 0.08835288882255554,
      "pose_rmse_dtheta": 0.6644743084907532,
      "pose_rmse_dx": 0.28290554881095886,
      "pose_rmse_dy": 0.19097226858139038,
      "pose_rmse_mean": 0.3794507384300232,
      "rmse_dtheta": 0.06983718276023865,
      "rmse_dx": 0.029768161475658417,
      "rmse_dy": 0.01650502346456051,
      "rmse_mean": 0.03870345652103424,
      "rotation_flip": 0.007285974454134703,
      "sparse_tokens": 9121.0,
      "step": 11694,
      "turn_loss": 0.5028197169303894,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 13927.0,
      "epoch": 0.5433469615313139,
      "grad_norm": 0.524509608745575,
      "learning_rate": 1.6361108782456113e-08,
      "loss": 0.1176,
      "mae_dtheta": 0.026545599102973938,
      "mae_dx": 0.008601397275924683,
      "mae_dy": 0.005500808823853731,
      "pose_mae_dtheta": 0.19637733697891235,
      "pose_mae_dx": 0.07835156470537186,
      "pose_mae_dy": 0.06027749553322792,
      "pose_rmse_dtheta": 0.3930974006652832,
      "pose_rmse_dx": 0.18135902285575867,
      "pose_rmse_dy": 0.14841030538082123,
      "pose_rmse_mean": 0.24095559120178223,
      "rmse_dtheta": 0.04268784448504448,
      "rmse_dx": 0.018729347735643387,
      "rmse_dy": 0.01176820695400238,
      "rmse_mean": 0.024395134299993515,
      "rotation_flip": 0.015406162478029728,
      "sparse_tokens": 10556.0,
      "step": 11695,
      "turn_loss": 0.2957037687301636,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5433934212971566,
      "grad_norm": 0.4904630780220032,
      "learning_rate": 1.625440604402062e-08,
      "loss": 0.1125,
      "mae_dtheta": 0.00974664743989706,
      "mae_dx": 0.001633089384995401,
      "mae_dy": 0.0020505478605628014,
      "pose_mae_dtheta": 0.06294184923171997,
      "pose_mae_dx": 0.016438888385891914,
      "pose_mae_dy": 0.021103385835886,
      "pose_rmse_dtheta": 0.1738511025905609,
      "pose_rmse_dx": 0.05880491062998772,
      "pose_rmse_dy": 0.06110299751162529,
      "pose_rmse_mean": 0.09791967272758484,
      "rmse_dtheta": 0.022821443155407906,
      "rmse_dx": 0.004897339269518852,
      "rmse_dy": 0.005179560277611017,
      "rmse_mean": 0.010966114699840546,
      "rotation_flip": 0.006058158352971077,
      "sparse_tokens": 32153.0,
      "step": 11696,
      "turn_loss": 0.08863428235054016,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5434398810629995,
      "grad_norm": 0.3710102140903473,
      "learning_rate": 1.614805182158896e-08,
      "loss": 0.1016,
      "mae_dtheta": 0.009610837325453758,
      "mae_dx": 0.0014709598617628217,
      "mae_dy": 0.0027109291404485703,
      "pose_mae_dtheta": 0.06166752800345421,
      "pose_mae_dx": 0.024024544283747673,
      "pose_mae_dy": 0.027900567278265953,
      "pose_rmse_dtheta": 0.16634394228458405,
      "pose_rmse_dx": 0.058055710047483444,
      "pose_rmse_dy": 0.059871379286050797,
      "pose_rmse_mean": 0.09475701302289963,
      "rmse_dtheta": 0.02089487388730049,
      "rmse_dx": 0.003615946974605322,
      "rmse_dy": 0.005484603811055422,
      "rmse_mean": 0.009998475201427937,
      "rotation_flip": 0.004066418390721083,
      "sparse_tokens": 32089.0,
      "step": 11697,
      "turn_loss": 0.08377224206924438,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5434863408288422,
      "grad_norm": 0.44674983620643616,
      "learning_rate": 1.6042046122599076e-08,
      "loss": 0.1246,
      "mae_dtheta": 0.00904931966215372,
      "mae_dx": 0.0011595592368394136,
      "mae_dy": 0.0019922994542866945,
      "pose_mae_dtheta": 0.056803617626428604,
      "pose_mae_dx": 0.01674606278538704,
      "pose_mae_dy": 0.02507079765200615,
      "pose_rmse_dtheta": 0.11947645992040634,
      "pose_rmse_dx": 0.04373019188642502,
      "pose_rmse_dy": 0.06136137992143631,
      "pose_rmse_mean": 0.07485601305961609,
      "rmse_dtheta": 0.019232282415032387,
      "rmse_dx": 0.003380726557224989,
      "rmse_dy": 0.004181964322924614,
      "rmse_mean": 0.00893165823072195,
      "rotation_flip": 0.007827788591384888,
      "sparse_tokens": 32089.0,
      "step": 11698,
      "turn_loss": 0.06990094482898712,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.543532800594685,
      "grad_norm": 0.621306836605072,
      "learning_rate": 1.5936388954463922e-08,
      "loss": 0.1445,
      "mae_dtheta": 0.025074463337659836,
      "mae_dx": 0.012022917158901691,
      "mae_dy": 0.0036192249972373247,
      "pose_mae_dtheta": 0.19993790984153748,
      "pose_mae_dx": 0.10481425374746323,
      "pose_mae_dy": 0.04838097468018532,
      "pose_rmse_dtheta": 0.37604087591171265,
      "pose_rmse_dx": 0.23270632326602936,
      "pose_rmse_dy": 0.09932942688465118,
      "pose_rmse_mean": 0.23602554202079773,
      "rmse_dtheta": 0.03995153307914734,
      "rmse_dx": 0.02491014078259468,
      "rmse_dy": 0.0061933733522892,
      "rmse_mean": 0.023685013875365257,
      "rotation_flip": 0.010230178944766521,
      "sparse_tokens": 6356.0,
      "step": 11699,
      "turn_loss": 0.20418083667755127,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.5435792603605278,
      "grad_norm": 0.5450153350830078,
      "learning_rate": 1.5831080324572034e-08,
      "loss": 0.0877,
      "mae_dtheta": 0.03709479048848152,
      "mae_dx": 0.014882519841194153,
      "mae_dy": 0.003908072132617235,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5450152158737183,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 139.4578094482422,
      "model/head/act_norm_mean": 101.69392903645833,
      "model/head/act_norm_min": 67.3603286743164,
      "model/head/act_over_embed": 69.88502010741797,
      "model/head/grad_frac": 0.08985906839370728,
      "model/head/grad_norm": 0.04897455871105194,
      "model/head/grad_zero_frac": 0.00017989308980759233,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6962076822916666,
      "model/head/update_ratio": 0.0008336810278706253,
      "model/head/weight_delta": 9.986031532287598,
      "model/head/weight_delta_rel": 0.17518457770347595,
      "model/head/weight_norm": 58.74496078491211,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229220151901245,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.422864990234375,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228177070617676,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059678021347496,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1275058388710022,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06949262320995331,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.534609375,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0022438792511820793,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569292545318604,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314671695232391,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969860076904297,
      "model/modality_embedder/grad_frac": 0.1275058388710022,
      "model/modality_embedder/grad_norm": 0.06949262320995331,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.534609375,
      "model/modality_embedder/update_ratio": 0.0022438792511820793,
      "model/modality_embedder/weight_delta": 3.1569292545318604,
      "model/modality_embedder/weight_delta_rel": 0.10314671695232391,
      "model/modality_embedder/weight_norm": 30.969860076904297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 72.407470703125,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.81823795056217,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.238855361938477,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.680906747335777,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0533079132437706,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.029053624719381332,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0010390669340267777,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.742877960205078,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995213150978088,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96126365661621,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 73.515380859375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.648605427414022,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.662704467773438,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.25154305145117,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.056733354926109314,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.030920540913939476,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001038614078424871,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4776268005371094,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12046770751476288,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770963668823242,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.93512725830078,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.291906932043652,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.828085899353027,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.380835230263727,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.056303199380636215,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03068610094487667,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0009981635957956314,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.767624855041504,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12650978565216064,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742555618286133,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 75.17293548583984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.138385106646826,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.847309112548828,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.649752318852062,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05548858642578125,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03024212457239628,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010095585603266954,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.238687753677368,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11068297922611237,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95578956604004,
      "model/normalizer/grad_frac": 0.21289007365703583,
      "model/normalizer/grad_norm": 0.11602833122015,
      "model/normalizer/grad_zero_frac": 0.00022453030396718532,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0014750962145626545,
      "model/normalizer/weight_delta": 6.810783863067627,
      "model/normalizer/weight_delta_rel": 0.08771895617246628,
      "model/normalizer/weight_norm": 78.65814208984375,
      "pose_mae_dtheta": 0.2829762399196625,
      "pose_mae_dx": 0.1264953762292862,
      "pose_mae_dy": 0.05709729343652725,
      "pose_rmse_dtheta": 0.4653805196285248,
      "pose_rmse_dx": 0.2638590931892395,
      "pose_rmse_dy": 0.10919810086488724,
      "pose_rmse_mean": 0.2794792354106903,
      "rmse_dtheta": 0.05451029911637306,
      "rmse_dx": 0.02849683351814747,
      "rmse_dy": 0.007010987494140863,
      "rmse_mean": 0.03000604175031185,
      "rotation_flip": 0.013888888992369175,
      "sparse_tokens": 6453.0,
      "step": 11700,
      "turn_loss": 0.2803533673286438,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5436257201263706,
      "grad_norm": 0.610924243927002,
      "learning_rate": 1.5726120240288632e-08,
      "loss": 0.1694,
      "mae_dtheta": 0.0057077594101428986,
      "mae_dx": 0.0011529892217367887,
      "mae_dy": 0.0013651626650243998,
      "pose_mae_dtheta": 0.04014965146780014,
      "pose_mae_dx": 0.0138173196464777,
      "pose_mae_dy": 0.016787264496088028,
      "pose_rmse_dtheta": 0.13224078714847565,
      "pose_rmse_dx": 0.03792201355099678,
      "pose_rmse_dy": 0.052400775253772736,
      "pose_rmse_mean": 0.07418785989284515,
      "rmse_dtheta": 0.017389768734574318,
      "rmse_dx": 0.003445051610469818,
      "rmse_dy": 0.003668987425044179,
      "rmse_mean": 0.008167936466634274,
      "rotation_flip": 0.001618996262550354,
      "sparse_tokens": 32089.0,
      "step": 11701,
      "turn_loss": 0.05385331064462662,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5436721798922134,
      "grad_norm": 0.5680183172225952,
      "learning_rate": 1.5621508708952294e-08,
      "loss": 0.1388,
      "mae_dtheta": 0.008104424923658371,
      "mae_dx": 0.0014511238550767303,
      "mae_dy": 0.0014233400579541922,
      "pose_mae_dtheta": 0.05885353684425354,
      "pose_mae_dx": 0.01957009546458721,
      "pose_mae_dy": 0.023303374648094177,
      "pose_rmse_dtheta": 0.15747803449630737,
      "pose_rmse_dx": 0.05082385241985321,
      "pose_rmse_dy": 0.06246127188205719,
      "pose_rmse_mean": 0.09025438874959946,
      "rmse_dtheta": 0.019995376467704773,
      "rmse_dx": 0.004701973404735327,
      "rmse_dy": 0.0033121653832495213,
      "rmse_mean": 0.009336505085229874,
      "rotation_flip": 0.004410143475979567,
      "sparse_tokens": 32057.0,
      "step": 11702,
      "turn_loss": 0.06492605805397034,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5437186396580561,
      "grad_norm": 0.4299151301383972,
      "learning_rate": 1.5517245737878827e-08,
      "loss": 0.1048,
      "mae_dtheta": 0.009252996183931828,
      "mae_dx": 0.0012051319936290383,
      "mae_dy": 0.0008536363602615893,
      "pose_mae_dtheta": 0.0635501816868782,
      "pose_mae_dx": 0.011419566348195076,
      "pose_mae_dy": 0.010917257517576218,
      "pose_rmse_dtheta": 0.24319908022880554,
      "pose_rmse_dx": 0.0292680524289608,
      "pose_rmse_dy": 0.02796986885368824,
      "pose_rmse_mean": 0.10014566779136658,
      "rmse_dtheta": 0.028823532164096832,
      "rmse_dx": 0.003519154153764248,
      "rmse_dy": 0.0017769000260159373,
      "rmse_mean": 0.011373195797204971,
      "rotation_flip": 0.0025176233612000942,
      "sparse_tokens": 32137.0,
      "step": 11703,
      "turn_loss": 0.04904754087328911,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11343.0,
      "epoch": 0.543765099423899,
      "grad_norm": 0.4997864067554474,
      "learning_rate": 1.541333133436018e-08,
      "loss": 0.126,
      "mae_dtheta": 0.030384564772248268,
      "mae_dx": 0.0107041634619236,
      "mae_dy": 0.005694661755114794,
      "pose_mae_dtheta": 0.2620047926902771,
      "pose_mae_dx": 0.07850878685712814,
      "pose_mae_dy": 0.08896994590759277,
      "pose_rmse_dtheta": 0.49890226125717163,
      "pose_rmse_dx": 0.1955782175064087,
      "pose_rmse_dy": 0.20602582395076752,
      "pose_rmse_mean": 0.3001687824726105,
      "rmse_dtheta": 0.04970701411366463,
      "rmse_dx": 0.02392798475921154,
      "rmse_dy": 0.010978886857628822,
      "rmse_mean": 0.028204627335071564,
      "rotation_flip": 0.017475727945566177,
      "sparse_tokens": 9549.0,
      "step": 11704,
      "turn_loss": 0.27171215415000916,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.5438115591897417,
      "grad_norm": 0.5823767781257629,
      "learning_rate": 1.530976550566221e-08,
      "loss": 0.1175,
      "mae_dtheta": 0.028916869312524796,
      "mae_dx": 0.013750680722296238,
      "mae_dy": 0.005106764379888773,
      "pose_mae_dtheta": 0.22116097807884216,
      "pose_mae_dx": 0.08989381045103073,
      "pose_mae_dy": 0.0830036997795105,
      "pose_rmse_dtheta": 0.34441709518432617,
      "pose_rmse_dx": 0.18386441469192505,
      "pose_rmse_dy": 0.16589047014713287,
      "pose_rmse_mean": 0.23139065504074097,
      "rmse_dtheta": 0.042376063764095306,
      "rmse_dx": 0.027363108471035957,
      "rmse_dy": 0.009073473513126373,
      "rmse_mean": 0.026270881295204163,
      "rotation_flip": 0.016949152573943138,
      "sparse_tokens": 7504.0,
      "step": 11705,
      "turn_loss": 0.24798238277435303,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 9434.0,
      "epoch": 0.5438580189555845,
      "grad_norm": 0.4883548319339752,
      "learning_rate": 1.5206548259028565e-08,
      "loss": 0.1193,
      "mae_dtheta": 0.03274199366569519,
      "mae_dx": 0.010863634757697582,
      "mae_dy": 0.005980596877634525,
      "pose_mae_dtheta": 0.23086689412593842,
      "pose_mae_dx": 0.11374985426664352,
      "pose_mae_dy": 0.08160599321126938,
      "pose_rmse_dtheta": 0.39853882789611816,
      "pose_rmse_dx": 0.2706841826438904,
      "pose_rmse_dy": 0.18209613859653473,
      "pose_rmse_mean": 0.2837730646133423,
      "rmse_dtheta": 0.048566192388534546,
      "rmse_dx": 0.02497023157775402,
      "rmse_dy": 0.012417315505445004,
      "rmse_mean": 0.028651248663663864,
      "rotation_flip": 0.017241379246115685,
      "sparse_tokens": 7996.0,
      "step": 11706,
      "turn_loss": 0.2052101194858551,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5439044787214272,
      "grad_norm": 0.4267881512641907,
      "learning_rate": 1.510367960167569e-08,
      "loss": 0.0948,
      "mae_dtheta": 0.008316747844219208,
      "mae_dx": 0.0012455617543309927,
      "mae_dy": 0.0020042317919433117,
      "pose_mae_dtheta": 0.057340607047080994,
      "pose_mae_dx": 0.017444485798478127,
      "pose_mae_dy": 0.01943538524210453,
      "pose_rmse_dtheta": 0.16887979209423065,
      "pose_rmse_dx": 0.04754245653748512,
      "pose_rmse_dy": 0.04936104640364647,
      "pose_rmse_mean": 0.08859442919492722,
      "rmse_dtheta": 0.02106861211359501,
      "rmse_dx": 0.0030630624387413263,
      "rmse_dy": 0.004806201905012131,
      "rmse_mean": 0.009645959362387657,
      "rotation_flip": 0.0032097003422677517,
      "sparse_tokens": 32185.0,
      "step": 11707,
      "turn_loss": 0.05909774452447891,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.54395093848727,
      "grad_norm": 0.5255613327026367,
      "learning_rate": 1.5001159540798393e-08,
      "loss": 0.1106,
      "mae_dtheta": 0.0066335322335362434,
      "mae_dx": 0.0013746717013418674,
      "mae_dy": 0.000398462318116799,
      "pose_mae_dtheta": 0.04510173946619034,
      "pose_mae_dx": 0.010802488774061203,
      "pose_mae_dy": 0.004718116018921137,
      "pose_rmse_dtheta": 0.19426104426383972,
      "pose_rmse_dx": 0.02716391533613205,
      "pose_rmse_dy": 0.018362220376729965,
      "pose_rmse_mean": 0.07992906868457794,
      "rmse_dtheta": 0.024519216269254684,
      "rmse_dx": 0.004131046123802662,
      "rmse_dy": 0.0015530900564044714,
      "rmse_mean": 0.01006778422743082,
      "rotation_flip": 0.002956830197945237,
      "sparse_tokens": 32201.0,
      "step": 11708,
      "turn_loss": 0.05260313302278519,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5439973982531128,
      "grad_norm": 0.2643527686595917,
      "learning_rate": 1.4898988083565936e-08,
      "loss": 0.0521,
      "mae_dtheta": 0.005101392976939678,
      "mae_dx": 0.0010330432560294867,
      "mae_dy": 0.00030633126152679324,
      "pose_mae_dtheta": 0.03365954011678696,
      "pose_mae_dx": 0.007928944192826748,
      "pose_mae_dy": 0.0034602046944200993,
      "pose_rmse_dtheta": 0.1683713048696518,
      "pose_rmse_dx": 0.0241647157818079,
      "pose_rmse_dy": 0.011655660346150398,
      "pose_rmse_mean": 0.0680638998746872,
      "rmse_dtheta": 0.022762872278690338,
      "rmse_dx": 0.003721537534147501,
      "rmse_dy": 0.0009760332177393138,
      "rmse_mean": 0.00915348157286644,
      "rotation_flip": 0.0033698398619890213,
      "sparse_tokens": 32137.0,
      "step": 11709,
      "turn_loss": 0.02698061615228653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5440438580189556,
      "grad_norm": 0.44379398226737976,
      "learning_rate": 1.4797165237122602e-08,
      "loss": 0.0919,
      "mae_dtheta": 0.011381377466022968,
      "mae_dx": 0.002611751202493906,
      "mae_dy": 0.003046799451112747,
      "pose_mae_dtheta": 0.0928768664598465,
      "pose_mae_dx": 0.02647959254682064,
      "pose_mae_dy": 0.030160633847117424,
      "pose_rmse_dtheta": 0.23042729496955872,
      "pose_rmse_dx": 0.09005802869796753,
      "pose_rmse_dy": 0.08476883918046951,
      "pose_rmse_mean": 0.13508471846580505,
      "rmse_dtheta": 0.02823570929467678,
      "rmse_dx": 0.0075974431820213795,
      "rmse_dy": 0.008928597904741764,
      "rmse_mean": 0.014920583926141262,
      "rotation_flip": 0.006384676788002253,
      "sparse_tokens": 32153.0,
      "step": 11710,
      "turn_loss": 0.11461503803730011,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5440903177847983,
      "grad_norm": 0.40329763293266296,
      "learning_rate": 1.4695691008589363e-08,
      "loss": 0.0968,
      "mae_dtheta": 0.009392167441546917,
      "mae_dx": 0.001240647048689425,
      "mae_dy": 0.0019304867601022124,
      "pose_mae_dtheta": 0.06626449525356293,
      "pose_mae_dx": 0.018277239054441452,
      "pose_mae_dy": 0.02440354786813259,
      "pose_rmse_dtheta": 0.178263857960701,
      "pose_rmse_dx": 0.047657810151576996,
      "pose_rmse_dy": 0.05712733790278435,
      "pose_rmse_mean": 0.09434966742992401,
      "rmse_dtheta": 0.021651510149240494,
      "rmse_dx": 0.0034714494831860065,
      "rmse_dy": 0.004027009475976229,
      "rmse_mean": 0.009716656059026718,
      "rotation_flip": 0.003456221194937825,
      "sparse_tokens": 32089.0,
      "step": 11711,
      "turn_loss": 0.07831934839487076,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5441367775506412,
      "grad_norm": 0.4133651852607727,
      "learning_rate": 1.4594565405062211e-08,
      "loss": 0.086,
      "mae_dtheta": 0.010942352935671806,
      "mae_dx": 0.001832016627304256,
      "mae_dy": 0.0017950574401766062,
      "pose_mae_dtheta": 0.07210566103458405,
      "pose_mae_dx": 0.021233318373560905,
      "pose_mae_dy": 0.02480674535036087,
      "pose_rmse_dtheta": 0.20301079750061035,
      "pose_rmse_dx": 0.055147044360637665,
      "pose_rmse_dy": 0.06409811973571777,
      "pose_rmse_mean": 0.10741865634918213,
      "rmse_dtheta": 0.024911431595683098,
      "rmse_dx": 0.006325305439531803,
      "rmse_dy": 0.003687990130856633,
      "rmse_mean": 0.011641575954854488,
      "rotation_flip": 0.0029190992936491966,
      "sparse_tokens": 32057.0,
      "step": 11712,
      "turn_loss": 0.09838423877954483,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 26283.0,
      "epoch": 0.5441832373164839,
      "grad_norm": 0.3806558847427368,
      "learning_rate": 1.449378843361271e-08,
      "loss": 0.1028,
      "mae_dtheta": 0.028041159734129906,
      "mae_dx": 0.009955733083188534,
      "mae_dy": 0.006399993319064379,
      "pose_mae_dtheta": 0.2119365632534027,
      "pose_mae_dx": 0.07212578505277634,
      "pose_mae_dy": 0.07881128042936325,
      "pose_rmse_dtheta": 0.3781529664993286,
      "pose_rmse_dx": 0.1623212844133377,
      "pose_rmse_dy": 0.1973722279071808,
      "pose_rmse_mean": 0.24594883620738983,
      "rmse_dtheta": 0.04472507908940315,
      "rmse_dx": 0.021840078756213188,
      "rmse_dy": 0.011573310010135174,
      "rmse_mean": 0.026046155020594597,
      "rotation_flip": 0.008873114362359047,
      "sparse_tokens": 21130.0,
      "step": 11713,
      "turn_loss": 0.26497626304626465,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 16836.0,
      "epoch": 0.5442296970823267,
      "grad_norm": 0.8998685479164124,
      "learning_rate": 1.4393360101288556e-08,
      "loss": 0.2168,
      "mae_dtheta": 0.02054048329591751,
      "mae_dx": 0.00796247087419033,
      "mae_dy": 0.004016462247818708,
      "pose_mae_dtheta": 0.13998684287071228,
      "pose_mae_dx": 0.06354553252458572,
      "pose_mae_dy": 0.04328418895602226,
      "pose_rmse_dtheta": 0.27145346999168396,
      "pose_rmse_dx": 0.14131037890911102,
      "pose_rmse_dy": 0.09698422253131866,
      "pose_rmse_mean": 0.16991601884365082,
      "rmse_dtheta": 0.034444328397512436,
      "rmse_dx": 0.019081922248005867,
      "rmse_dy": 0.008019480854272842,
      "rmse_mean": 0.02051524445414543,
      "rotation_flip": 0.012547051534056664,
      "sparse_tokens": 14225.0,
      "step": 11714,
      "turn_loss": 0.15769073367118835,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5442761568481694,
      "grad_norm": 0.2927223742008209,
      "learning_rate": 1.429328041511302e-08,
      "loss": 0.07,
      "mae_dtheta": 0.007756933569908142,
      "mae_dx": 0.0010092975571751595,
      "mae_dy": 0.0011932887136936188,
      "pose_mae_dtheta": 0.052431460469961166,
      "pose_mae_dx": 0.012098372913897038,
      "pose_mae_dy": 0.01281404122710228,
      "pose_rmse_dtheta": 0.2197294384241104,
      "pose_rmse_dx": 0.03136826306581497,
      "pose_rmse_dy": 0.03502316772937775,
      "pose_rmse_mean": 0.09537363052368164,
      "rmse_dtheta": 0.02439877949655056,
      "rmse_dx": 0.003058641916140914,
      "rmse_dy": 0.003765227273106575,
      "rmse_mean": 0.010407550260424614,
      "rotation_flip": 0.0014771048445254564,
      "sparse_tokens": 32121.0,
      "step": 11715,
      "turn_loss": 0.051813337951898575,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 2955.0,
      "epoch": 0.5443226166140123,
      "grad_norm": 0.7058252096176147,
      "learning_rate": 1.4193549382083837e-08,
      "loss": 0.1305,
      "mae_dtheta": 0.018955310806632042,
      "mae_dx": 0.01029048953205347,
      "mae_dy": 0.004003221169114113,
      "pose_mae_dtheta": 0.11778169125318527,
      "pose_mae_dx": 0.07961466163396835,
      "pose_mae_dy": 0.05254632607102394,
      "pose_rmse_dtheta": 0.18379920721054077,
      "pose_rmse_dx": 0.20553307235240936,
      "pose_rmse_dy": 0.14288058876991272,
      "pose_rmse_mean": 0.1774042844772339,
      "rmse_dtheta": 0.028185507282614708,
      "rmse_dx": 0.02423110418021679,
      "rmse_dy": 0.007024688646197319,
      "rmse_mean": 0.019813766703009605,
      "rotation_flip": 0.006369426846504211,
      "sparse_tokens": 2327.0,
      "step": 11716,
      "turn_loss": 0.19799260795116425,
      "turns": 9.0,
      "turns_per_sample": 9.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5443690763798551,
      "grad_norm": 0.6978204250335693,
      "learning_rate": 1.409416700917654e-08,
      "loss": 0.1811,
      "mae_dtheta": 0.01076117530465126,
      "mae_dx": 0.0011776373721659184,
      "mae_dy": 0.0025116456672549248,
      "pose_mae_dtheta": 0.0685359314084053,
      "pose_mae_dx": 0.02146020345389843,
      "pose_mae_dy": 0.03350301831960678,
      "pose_rmse_dtheta": 0.14657540619373322,
      "pose_rmse_dx": 0.05046281963586807,
      "pose_rmse_dy": 0.08789364993572235,
      "pose_rmse_mean": 0.09497730433940887,
      "rmse_dtheta": 0.020802540704607964,
      "rmse_dx": 0.0034509676042944193,
      "rmse_dy": 0.005143799819052219,
      "rmse_mean": 0.009799103252589703,
      "rotation_flip": 0.0036509674973785877,
      "sparse_tokens": 32089.0,
      "step": 11717,
      "turn_loss": 0.08210965991020203,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5444155361456978,
      "grad_norm": 0.4358370006084442,
      "learning_rate": 1.3995133303339459e-08,
      "loss": 0.0765,
      "mae_dtheta": 0.007981570437550545,
      "mae_dx": 0.002564540598541498,
      "mae_dy": 0.0015065745683386922,
      "pose_mae_dtheta": 0.05163605138659477,
      "pose_mae_dx": 0.020725950598716736,
      "pose_mae_dy": 0.018268074840307236,
      "pose_rmse_dtheta": 0.15979111194610596,
      "pose_rmse_dx": 0.054809946566820145,
      "pose_rmse_dy": 0.04982191324234009,
      "pose_rmse_mean": 0.08814098685979843,
      "rmse_dtheta": 0.020665284246206284,
      "rmse_dx": 0.00830383412539959,
      "rmse_dy": 0.00366394966840744,
      "rmse_mean": 0.010877689346671104,
      "rotation_flip": 0.0017286085058003664,
      "sparse_tokens": 32185.0,
      "step": 11718,
      "turn_loss": 0.0900723934173584,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11379.0,
      "epoch": 0.5444619959115407,
      "grad_norm": 0.5537616610527039,
      "learning_rate": 1.3896448271499275e-08,
      "loss": 0.156,
      "mae_dtheta": 0.02487640455365181,
      "mae_dx": 0.013214429840445518,
      "mae_dy": 0.0032781066838651896,
      "pose_mae_dtheta": 0.18542589247226715,
      "pose_mae_dx": 0.105799101293087,
      "pose_mae_dy": 0.03995664045214653,
      "pose_rmse_dtheta": 0.35150396823883057,
      "pose_rmse_dx": 0.25555676221847534,
      "pose_rmse_dy": 0.09391002357006073,
      "pose_rmse_mean": 0.23365692794322968,
      "rmse_dtheta": 0.04037017747759819,
      "rmse_dx": 0.02635394223034382,
      "rmse_dy": 0.006421507336199284,
      "rmse_mean": 0.02438187599182129,
      "rotation_flip": 0.01933216117322445,
      "sparse_tokens": 9315.0,
      "step": 11719,
      "turn_loss": 0.20536847412586212,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.5445084556773834,
      "grad_norm": 0.4995628893375397,
      "learning_rate": 1.3798111920556578e-08,
      "loss": 0.1097,
      "mae_dtheta": 0.0313134528696537,
      "mae_dx": 0.005969025660306215,
      "mae_dy": 0.004726138897240162,
      "pose_mae_dtheta": 0.23586902022361755,
      "pose_mae_dx": 0.05037735402584076,
      "pose_mae_dy": 0.07964326441287994,
      "pose_rmse_dtheta": 0.47792890667915344,
      "pose_rmse_dx": 0.14398764073848724,
      "pose_rmse_dy": 0.16061732172966003,
      "pose_rmse_mean": 0.2608446478843689,
      "rmse_dtheta": 0.052741941064596176,
      "rmse_dx": 0.017466984689235687,
      "rmse_dy": 0.008145314641296864,
      "rmse_mean": 0.02611808106303215,
      "rotation_flip": 0.00638977624475956,
      "sparse_tokens": 5171.0,
      "step": 11720,
      "turn_loss": 0.20128922164440155,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5445549154432262,
      "grad_norm": 0.3681192696094513,
      "learning_rate": 1.3700124257388092e-08,
      "loss": 0.0807,
      "mae_dtheta": 0.008918078616261482,
      "mae_dx": 0.001917308196425438,
      "mae_dy": 0.0025570662692189217,
      "pose_mae_dtheta": 0.06373351812362671,
      "pose_mae_dx": 0.01884407363831997,
      "pose_mae_dy": 0.02240682952105999,
      "pose_rmse_dtheta": 0.16386710107326508,
      "pose_rmse_dx": 0.048456013202667236,
      "pose_rmse_dy": 0.05186450108885765,
      "pose_rmse_mean": 0.08806253969669342,
      "rmse_dtheta": 0.02175646834075451,
      "rmse_dx": 0.006852373946458101,
      "rmse_dy": 0.007054868154227734,
      "rmse_mean": 0.011887903325259686,
      "rotation_flip": 0.002978723496198654,
      "sparse_tokens": 32089.0,
      "step": 11721,
      "turn_loss": 0.09111271798610687,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5446013752090689,
      "grad_norm": 0.36176392436027527,
      "learning_rate": 1.3602485288846112e-08,
      "loss": 0.08,
      "mae_dtheta": 0.010102910920977592,
      "mae_dx": 0.0012503579491749406,
      "mae_dy": 0.0023721749894320965,
      "pose_mae_dtheta": 0.06461237370967865,
      "pose_mae_dx": 0.014736060984432697,
      "pose_mae_dy": 0.026079025119543076,
      "pose_rmse_dtheta": 0.14818377792835236,
      "pose_rmse_dx": 0.03840721771121025,
      "pose_rmse_dy": 0.05630762130022049,
      "pose_rmse_mean": 0.08096620440483093,
      "rmse_dtheta": 0.021867945790290833,
      "rmse_dx": 0.003849443281069398,
      "rmse_dy": 0.0051939887925982475,
      "rmse_mean": 0.010303793475031853,
      "rotation_flip": 0.006424965802580118,
      "sparse_tokens": 32073.0,
      "step": 11722,
      "turn_loss": 0.07686944305896759,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5446478349749118,
      "grad_norm": 0.5684541463851929,
      "learning_rate": 1.3505195021759066e-08,
      "loss": 0.151,
      "mae_dtheta": 0.013893499970436096,
      "mae_dx": 0.0018189104739576578,
      "mae_dy": 0.0032667822670191526,
      "pose_mae_dtheta": 0.08674678951501846,
      "pose_mae_dx": 0.02625378407537937,
      "pose_mae_dy": 0.03117474354803562,
      "pose_rmse_dtheta": 0.23007982969284058,
      "pose_rmse_dx": 0.07107636332511902,
      "pose_rmse_dy": 0.06571269035339355,
      "pose_rmse_mean": 0.12228962779045105,
      "rmse_dtheta": 0.028730839490890503,
      "rmse_dx": 0.0053990064188838005,
      "rmse_dy": 0.006688891444355249,
      "rmse_mean": 0.013606246560811996,
      "rotation_flip": 0.010869565419852734,
      "sparse_tokens": 32089.0,
      "step": 11723,
      "turn_loss": 0.11455108225345612,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5446942947407545,
      "grad_norm": 0.4306963086128235,
      "learning_rate": 1.3408253462930399e-08,
      "loss": 0.0704,
      "mae_dtheta": 0.008047434501349926,
      "mae_dx": 0.0010664111468940973,
      "mae_dy": 0.001870040548965335,
      "pose_mae_dtheta": 0.056146152317523956,
      "pose_mae_dx": 0.0159198809415102,
      "pose_mae_dy": 0.023223893716931343,
      "pose_rmse_dtheta": 0.16471005976200104,
      "pose_rmse_dx": 0.04985363781452179,
      "pose_rmse_dy": 0.0571676529943943,
      "pose_rmse_mean": 0.09057711809873581,
      "rmse_dtheta": 0.01990746706724167,
      "rmse_dx": 0.003246879205107689,
      "rmse_dy": 0.0043413834646344185,
      "rmse_mean": 0.009165244176983833,
      "rotation_flip": 0.003764705965295434,
      "sparse_tokens": 32041.0,
      "step": 11724,
      "turn_loss": 0.060314130038022995,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20387.0,
      "epoch": 0.5447407545065973,
      "grad_norm": 0.4967891275882721,
      "learning_rate": 1.3311660619138578e-08,
      "loss": 0.1305,
      "mae_dtheta": 0.03138672560453415,
      "mae_dx": 0.01100143976509571,
      "mae_dy": 0.007020158693194389,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.4967890679836273,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 137.84664916992188,
      "model/head/act_norm_mean": 103.12996031746032,
      "model/head/act_norm_min": 74.23893737792969,
      "model/head/act_over_embed": 70.8718742480592,
      "model/head/grad_frac": 0.12490932643413544,
      "model/head/grad_norm": 0.06205358728766441,
      "model/head/grad_zero_frac": 0.00019258396059740335,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7090928819444444,
      "model/head/update_ratio": 0.0010563217801973224,
      "model/head/weight_delta": 9.986053466796875,
      "model/head/weight_delta_rel": 0.1751849502325058,
      "model/head/weight_norm": 58.74496841430664,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42286911606788635,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42286911606788635,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42286911606788635,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905996155248906,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08721102029085159,
      "model/modality_embedder.encoders.pose/grad_norm": 0.043325480073690414,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013989564031362534,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569225788116455,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1031465008854866,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969858169555664,
      "model/modality_embedder/grad_frac": 0.08721102029085159,
      "model/modality_embedder/grad_norm": 0.043325480073690414,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0013989564031362534,
      "model/modality_embedder/weight_delta": 3.1569225788116455,
      "model/modality_embedder/weight_delta_rel": 0.1031465008854866,
      "model/modality_embedder/weight_norm": 30.969858169555664,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.47870635986328,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.924758676618797,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.22604751586914,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.75410878754464,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10822059959173203,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05376281216740608,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001922760158777237,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7428934574127197,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995269030332565,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961267471313477,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 76.78334045410156,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.685305256361804,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.342584609985352,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.276763517493297,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.09689857810735703,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.048138152807950974,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0016169494483619928,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4776482582092285,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12046845257282257,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77096939086914,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.22126770019531,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.275333049886623,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.661766052246094,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.36944550327829,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08669599145650864,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04306961968541145,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014009771402925253,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7676472663879395,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12651054561138153,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742557525634766,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 78.41497802734375,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.201920351473923,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.812121391296387,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.693414333923577,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07350438833236694,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03651617839932442,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0003379196277819574,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0012190021807327867,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2387125492095947,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11068382859230042,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955795288085938,
      "model/normalizer/grad_frac": 0.312839537858963,
      "model/normalizer/grad_norm": 0.15541526675224304,
      "model/normalizer/grad_zero_frac": 0.0002505285374354571,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0019758318085223436,
      "model/normalizer/weight_delta": 6.810827732086182,
      "model/normalizer/weight_delta_rel": 0.08771951496601105,
      "model/normalizer/weight_norm": 78.65814208984375,
      "pose_mae_dtheta": 0.22634723782539368,
      "pose_mae_dx": 0.09215343743562698,
      "pose_mae_dy": 0.08464521169662476,
      "pose_rmse_dtheta": 0.393995463848114,
      "pose_rmse_dx": 0.19826506078243256,
      "pose_rmse_dy": 0.15314263105392456,
      "pose_rmse_mean": 0.24846772849559784,
      "rmse_dtheta": 0.04591386020183563,
      "rmse_dx": 0.02284206636250019,
      "rmse_dy": 0.01154458336532116,
      "rmse_mean": 0.026766836643218994,
      "rotation_flip": 0.018269231542944908,
      "sparse_tokens": 17392.0,
      "step": 11725,
      "turn_loss": 0.2727390229701996,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.54478721427244,
      "grad_norm": 0.7133822441101074,
      "learning_rate": 1.3215416497138756e-08,
      "loss": 0.1401,
      "mae_dtheta": 0.027174407616257668,
      "mae_dx": 0.009908944368362427,
      "mae_dy": 0.00412824098020792,
      "pose_mae_dtheta": 0.18078021705150604,
      "pose_mae_dx": 0.06349705159664154,
      "pose_mae_dy": 0.04797497019171715,
      "pose_rmse_dtheta": 0.3317462205886841,
      "pose_rmse_dx": 0.1468084156513214,
      "pose_rmse_dy": 0.12997977435588837,
      "pose_rmse_mean": 0.2028447985649109,
      "rmse_dtheta": 0.04322969540953636,
      "rmse_dx": 0.022090185433626175,
      "rmse_dy": 0.009947311133146286,
      "rmse_mean": 0.025089066475629807,
      "rotation_flip": 0.011283498257398605,
      "sparse_tokens": 12558.0,
      "step": 11726,
      "turn_loss": 0.213947594165802,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5448336740382829,
      "grad_norm": 0.5612362027168274,
      "learning_rate": 1.311952110366166e-08,
      "loss": 0.111,
      "mae_dtheta": 0.012298133224248886,
      "mae_dx": 0.001541065750643611,
      "mae_dy": 0.0038865834940224886,
      "pose_mae_dtheta": 0.0760563313961029,
      "pose_mae_dx": 0.028076278045773506,
      "pose_mae_dy": 0.04385757073760033,
      "pose_rmse_dtheta": 0.18915234506130219,
      "pose_rmse_dx": 0.07837554812431335,
      "pose_rmse_dy": 0.12865622341632843,
      "pose_rmse_mean": 0.13206136226654053,
      "rmse_dtheta": 0.025048760697245598,
      "rmse_dx": 0.003876336384564638,
      "rmse_dy": 0.009533288888633251,
      "rmse_mean": 0.012819461524486542,
      "rotation_flip": 0.006550218444317579,
      "sparse_tokens": 32057.0,
      "step": 11727,
      "turn_loss": 0.10075812041759491,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5448801338041256,
      "grad_norm": 0.44199350476264954,
      "learning_rate": 1.3023974445413034e-08,
      "loss": 0.1291,
      "mae_dtheta": 0.012285149656236172,
      "mae_dx": 0.00163091323338449,
      "mae_dy": 0.002660113386809826,
      "pose_mae_dtheta": 0.08211134374141693,
      "pose_mae_dx": 0.02045918069779873,
      "pose_mae_dy": 0.025678804144263268,
      "pose_rmse_dtheta": 0.220342218875885,
      "pose_rmse_dx": 0.05248976871371269,
      "pose_rmse_dy": 0.060452718287706375,
      "pose_rmse_mean": 0.11109490692615509,
      "rmse_dtheta": 0.027222711592912674,
      "rmse_dx": 0.004654277581721544,
      "rmse_dy": 0.006003412418067455,
      "rmse_mean": 0.012626800686120987,
      "rotation_flip": 0.005639097653329372,
      "sparse_tokens": 32185.0,
      "step": 11728,
      "turn_loss": 0.08290760964155197,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5449265935699684,
      "grad_norm": 0.48929405212402344,
      "learning_rate": 1.2928776529074205e-08,
      "loss": 0.1036,
      "mae_dtheta": 0.01124422438442707,
      "mae_dx": 0.0020632133819162846,
      "mae_dy": 0.003945773933082819,
      "pose_mae_dtheta": 0.06900030374526978,
      "pose_mae_dx": 0.023884963244199753,
      "pose_mae_dy": 0.03494565561413765,
      "pose_rmse_dtheta": 0.1443377137184143,
      "pose_rmse_dx": 0.05850957706570625,
      "pose_rmse_dy": 0.10807565599679947,
      "pose_rmse_mean": 0.10364098846912384,
      "rmse_dtheta": 0.022311890497803688,
      "rmse_dx": 0.005412151105701923,
      "rmse_dy": 0.008538995869457722,
      "rmse_mean": 0.012087679468095303,
      "rotation_flip": 0.012894469313323498,
      "sparse_tokens": 32105.0,
      "step": 11729,
      "turn_loss": 0.11397960782051086,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64633.0,
      "epoch": 0.5449730533358111,
      "grad_norm": 0.4913311302661896,
      "learning_rate": 1.2833927361303178e-08,
      "loss": 0.1064,
      "mae_dtheta": 0.007013766560703516,
      "mae_dx": 0.0010109764989465475,
      "mae_dy": 0.00020596843387465924,
      "pose_mae_dtheta": 0.046589143574237823,
      "pose_mae_dx": 0.007440539076924324,
      "pose_mae_dy": 0.002664871048182249,
      "pose_rmse_dtheta": 0.22344256937503815,
      "pose_rmse_dx": 0.015603069216012955,
      "pose_rmse_dy": 0.0068398937582969666,
      "pose_rmse_mean": 0.08196184039115906,
      "rmse_dtheta": 0.028287354856729507,
      "rmse_dx": 0.002632130403071642,
      "rmse_dy": 0.0004785449418704957,
      "rmse_mean": 0.010466009378433228,
      "rotation_flip": 0.0011448196601122618,
      "sparse_tokens": 32233.0,
      "step": 11730,
      "turn_loss": 0.04187910631299019,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.545019513101654,
      "grad_norm": 0.5691350102424622,
      "learning_rate": 1.2739426948732426e-08,
      "loss": 0.1439,
      "mae_dtheta": 0.03309190645813942,
      "mae_dx": 0.013663757592439651,
      "mae_dy": 0.005839465651661158,
      "pose_mae_dtheta": 0.2592068016529083,
      "pose_mae_dx": 0.10033590346574783,
      "pose_mae_dy": 0.08383335918188095,
      "pose_rmse_dtheta": 0.41450437903404236,
      "pose_rmse_dx": 0.2331208437681198,
      "pose_rmse_dy": 0.16992056369781494,
      "pose_rmse_mean": 0.27251526713371277,
      "rmse_dtheta": 0.048327382653951645,
      "rmse_dx": 0.02709071896970272,
      "rmse_dy": 0.01040424033999443,
      "rmse_mean": 0.028607448562979698,
      "rotation_flip": 0.017587939277291298,
      "sparse_tokens": 6749.0,
      "step": 11731,
      "turn_loss": 0.23643016815185547,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 12635.0,
      "epoch": 0.5450659728674967,
      "grad_norm": 0.6996355652809143,
      "learning_rate": 1.2645275297969995e-08,
      "loss": 0.166,
      "mae_dtheta": 0.03903084620833397,
      "mae_dx": 0.010900028981268406,
      "mae_dy": 0.004824876319617033,
      "pose_mae_dtheta": 0.3118427097797394,
      "pose_mae_dx": 0.09029570966959,
      "pose_mae_dy": 0.05793857201933861,
      "pose_rmse_dtheta": 0.5424440503120422,
      "pose_rmse_dx": 0.19766832888126373,
      "pose_rmse_dy": 0.1368892639875412,
      "pose_rmse_mean": 0.2923339009284973,
      "rmse_dtheta": 0.05791832134127617,
      "rmse_dx": 0.02201986126601696,
      "rmse_dy": 0.009802477434277534,
      "rmse_mean": 0.02991355210542679,
      "rotation_flip": 0.022624434903264046,
      "sparse_tokens": 10298.0,
      "step": 11732,
      "turn_loss": 0.2825494408607483,
      "turns": 39.0,
      "turns_per_sample": 39.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5451124326333395,
      "grad_norm": 0.38774174451828003,
      "learning_rate": 1.2551472415600619e-08,
      "loss": 0.0878,
      "mae_dtheta": 0.011830472387373447,
      "mae_dx": 0.0022990854922682047,
      "mae_dy": 0.004047721158713102,
      "pose_mae_dtheta": 0.07897990942001343,
      "pose_mae_dx": 0.020830215886235237,
      "pose_mae_dy": 0.03136536106467247,
      "pose_rmse_dtheta": 0.21970099210739136,
      "pose_rmse_dx": 0.04790336266160011,
      "pose_rmse_dy": 0.06888188421726227,
      "pose_rmse_mean": 0.11216207593679428,
      "rmse_dtheta": 0.025156933814287186,
      "rmse_dx": 0.007861796766519547,
      "rmse_dy": 0.009686917997896671,
      "rmse_mean": 0.014235216192901134,
      "rotation_flip": 0.008729388937354088,
      "sparse_tokens": 32121.0,
      "step": 11733,
      "turn_loss": 0.11896081268787384,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9082.0,
      "epoch": 0.5451588923991824,
      "grad_norm": 0.4397779107093811,
      "learning_rate": 1.2458018308183495e-08,
      "loss": 0.1044,
      "mae_dtheta": 0.03855256363749504,
      "mae_dx": 0.009976238943636417,
      "mae_dy": 0.003196579869836569,
      "pose_mae_dtheta": 0.338165283203125,
      "pose_mae_dx": 0.07504738122224808,
      "pose_mae_dy": 0.030405821278691292,
      "pose_rmse_dtheta": 0.5706578493118286,
      "pose_rmse_dx": 0.20094731450080872,
      "pose_rmse_dy": 0.0715995728969574,
      "pose_rmse_mean": 0.28106826543807983,
      "rmse_dtheta": 0.05754058435559273,
      "rmse_dx": 0.021653912961483,
      "rmse_dy": 0.0064371912740170956,
      "rmse_mean": 0.028543896973133087,
      "rotation_flip": 0.007425742689520121,
      "sparse_tokens": 6859.0,
      "step": 11734,
      "turn_loss": 0.30806583166122437,
      "turns": 28.0,
      "turns_per_sample": 28.0
    },
    {
      "dense_tokens": 18183.0,
      "epoch": 0.5452053521650251,
      "grad_norm": 0.7557189464569092,
      "learning_rate": 1.2364912982254507e-08,
      "loss": 0.1545,
      "mae_dtheta": 0.0254256222397089,
      "mae_dx": 0.006862747482955456,
      "mae_dy": 0.006952974945306778,
      "pose_mae_dtheta": 0.18383298814296722,
      "pose_mae_dx": 0.05535120144486427,
      "pose_mae_dy": 0.07534454762935638,
      "pose_rmse_dtheta": 0.34227415919303894,
      "pose_rmse_dx": 0.14320491254329681,
      "pose_rmse_dy": 0.21437929570674896,
      "pose_rmse_mean": 0.23328612744808197,
      "rmse_dtheta": 0.04188816621899605,
      "rmse_dx": 0.014907937496900558,
      "rmse_dy": 0.01673991046845913,
      "rmse_mean": 0.02451200596988201,
      "rotation_flip": 0.01490683201700449,
      "sparse_tokens": 13929.0,
      "step": 11735,
      "turn_loss": 0.2538805902004242,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5452518119308679,
      "grad_norm": 0.49818941950798035,
      "learning_rate": 1.2272156444324001e-08,
      "loss": 0.1208,
      "mae_dtheta": 0.008596554398536682,
      "mae_dx": 0.0011982350843027234,
      "mae_dy": 0.0016483551589772105,
      "pose_mae_dtheta": 0.054264940321445465,
      "pose_mae_dx": 0.013842683285474777,
      "pose_mae_dy": 0.02179754711687565,
      "pose_rmse_dtheta": 0.15932925045490265,
      "pose_rmse_dx": 0.037611596286296844,
      "pose_rmse_dy": 0.049622759222984314,
      "pose_rmse_mean": 0.08218786865472794,
      "rmse_dtheta": 0.02084924839437008,
      "rmse_dx": 0.003927181474864483,
      "rmse_dy": 0.004243472125381231,
      "rmse_mean": 0.009673301130533218,
      "rotation_flip": 0.004844570066779852,
      "sparse_tokens": 32105.0,
      "step": 11736,
      "turn_loss": 0.06846264749765396,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5452982716967106,
      "grad_norm": 0.6830542683601379,
      "learning_rate": 1.2179748700879013e-08,
      "loss": 0.1232,
      "mae_dtheta": 0.010433544404804707,
      "mae_dx": 0.0023159210104495287,
      "mae_dy": 0.003803903702646494,
      "pose_mae_dtheta": 0.06829063594341278,
      "pose_mae_dx": 0.028630120679736137,
      "pose_mae_dy": 0.031106604263186455,
      "pose_rmse_dtheta": 0.13727445900440216,
      "pose_rmse_dx": 0.08875415474176407,
      "pose_rmse_dy": 0.07291453331708908,
      "pose_rmse_mean": 0.09964772313833237,
      "rmse_dtheta": 0.019556580111384392,
      "rmse_dx": 0.006623307708650827,
      "rmse_dy": 0.0089579401537776,
      "rmse_mean": 0.01171260979026556,
      "rotation_flip": 0.005173688288778067,
      "sparse_tokens": 32121.0,
      "step": 11737,
      "turn_loss": 0.10288887470960617,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5453447314625535,
      "grad_norm": 0.5293824672698975,
      "learning_rate": 1.2087689758380483e-08,
      "loss": 0.1412,
      "mae_dtheta": 0.006085044704377651,
      "mae_dx": 0.001300063100643456,
      "mae_dy": 0.0012078678701072931,
      "pose_mae_dtheta": 0.04011078178882599,
      "pose_mae_dx": 0.013625584542751312,
      "pose_mae_dy": 0.013804713264107704,
      "pose_rmse_dtheta": 0.1218399852514267,
      "pose_rmse_dx": 0.044178470969200134,
      "pose_rmse_dy": 0.03202873095870018,
      "pose_rmse_mean": 0.06601573526859283,
      "rmse_dtheta": 0.01593727432191372,
      "rmse_dx": 0.004972362890839577,
      "rmse_dy": 0.0028748533222824335,
      "rmse_mean": 0.00792816374450922,
      "rotation_flip": 0.0016556291375309229,
      "sparse_tokens": 32073.0,
      "step": 11738,
      "turn_loss": 0.04918573796749115,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.5453911912283962,
      "grad_norm": 0.3168254792690277,
      "learning_rate": 1.1995979623267706e-08,
      "loss": 0.0783,
      "mae_dtheta": 0.05262709781527519,
      "mae_dx": 0.012551874853670597,
      "mae_dy": 0.0057300180196762085,
      "pose_mae_dtheta": 0.4051287770271301,
      "pose_mae_dx": 0.10700217634439468,
      "pose_mae_dy": 0.05175337195396423,
      "pose_rmse_dtheta": 0.6619489789009094,
      "pose_rmse_dx": 0.2508223056793213,
      "pose_rmse_dy": 0.1397201418876648,
      "pose_rmse_mean": 0.3508304953575134,
      "rmse_dtheta": 0.07328099012374878,
      "rmse_dx": 0.025609148666262627,
      "rmse_dy": 0.013075531460344791,
      "rmse_mean": 0.03732189163565636,
      "rotation_flip": 0.014563106931746006,
      "sparse_tokens": 9804.0,
      "step": 11739,
      "turn_loss": 0.2773486077785492,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.545437650994239,
      "grad_norm": 0.6427414417266846,
      "learning_rate": 1.190461830195333e-08,
      "loss": 0.0978,
      "mae_dtheta": 0.03160497546195984,
      "mae_dx": 0.009883352555334568,
      "mae_dy": 0.004675833508372307,
      "pose_mae_dtheta": 0.23039674758911133,
      "pose_mae_dx": 0.07258907705545425,
      "pose_mae_dy": 0.05128713697195053,
      "pose_rmse_dtheta": 0.4557129442691803,
      "pose_rmse_dx": 0.16308589279651642,
      "pose_rmse_dy": 0.127065047621727,
      "pose_rmse_mean": 0.24862131476402283,
      "rmse_dtheta": 0.05083536356687546,
      "rmse_dx": 0.020955901592969894,
      "rmse_dy": 0.01037371251732111,
      "rmse_mean": 0.027388324961066246,
      "rotation_flip": 0.016393441706895828,
      "sparse_tokens": 8947.0,
      "step": 11740,
      "turn_loss": 0.22360926866531372,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 11054.0,
      "epoch": 0.5454841107600817,
      "grad_norm": 0.5487648844718933,
      "learning_rate": 1.1813605800825578e-08,
      "loss": 0.1404,
      "mae_dtheta": 0.032656606286764145,
      "mae_dx": 0.018939174711704254,
      "mae_dy": 0.005754793528467417,
      "pose_mae_dtheta": 0.2385825663805008,
      "pose_mae_dx": 0.14762046933174133,
      "pose_mae_dy": 0.07351482659578323,
      "pose_rmse_dtheta": 0.40479621291160583,
      "pose_rmse_dx": 0.2832154929637909,
      "pose_rmse_dy": 0.17338144779205322,
      "pose_rmse_mean": 0.28713107109069824,
      "rmse_dtheta": 0.0471624881029129,
      "rmse_dx": 0.0313386470079422,
      "rmse_dy": 0.012349748983979225,
      "rmse_mean": 0.030283628031611443,
      "rotation_flip": 0.007984031923115253,
      "sparse_tokens": 8669.0,
      "step": 11741,
      "turn_loss": 0.2965618073940277,
      "turns": 34.0,
      "turns_per_sample": 34.0
    },
    {
      "dense_tokens": 11989.0,
      "epoch": 0.5455305705259246,
      "grad_norm": 0.5578999519348145,
      "learning_rate": 1.1722942126250469e-08,
      "loss": 0.1456,
      "mae_dtheta": 0.04155229032039642,
      "mae_dx": 0.019145185127854347,
      "mae_dy": 0.0039194864220917225,
      "pose_mae_dtheta": 0.3794456720352173,
      "pose_mae_dx": 0.16916699707508087,
      "pose_mae_dy": 0.07238231599330902,
      "pose_rmse_dtheta": 0.571968138217926,
      "pose_rmse_dx": 0.3221921920776367,
      "pose_rmse_dy": 0.18304021656513214,
      "pose_rmse_mean": 0.35906684398651123,
      "rmse_dtheta": 0.05743538588285446,
      "rmse_dx": 0.03280218318104744,
      "rmse_dy": 0.007801610045135021,
      "rmse_mean": 0.0326797291636467,
      "rotation_flip": 0.008146639913320541,
      "sparse_tokens": 9844.0,
      "step": 11742,
      "turn_loss": 0.3519766926765442,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5455770302917673,
      "grad_norm": 0.4641484320163727,
      "learning_rate": 1.1632627284566822e-08,
      "loss": 0.1049,
      "mae_dtheta": 0.013587084598839283,
      "mae_dx": 0.0031508065294474363,
      "mae_dy": 0.004944765008985996,
      "pose_mae_dtheta": 0.0968412309885025,
      "pose_mae_dx": 0.04356526955962181,
      "pose_mae_dy": 0.040179815143346786,
      "pose_rmse_dtheta": 0.18999509513378143,
      "pose_rmse_dx": 0.10524643957614899,
      "pose_rmse_dy": 0.09015043079853058,
      "pose_rmse_mean": 0.1284639835357666,
      "rmse_dtheta": 0.024978769943118095,
      "rmse_dx": 0.0070561012253165245,
      "rmse_dy": 0.009430894628167152,
      "rmse_mean": 0.013821922242641449,
      "rotation_flip": 0.006809338461607695,
      "sparse_tokens": 32121.0,
      "step": 11743,
      "turn_loss": 0.14413902163505554,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6498.0,
      "epoch": 0.5456234900576101,
      "grad_norm": 0.5789838433265686,
      "learning_rate": 1.154266128209125e-08,
      "loss": 0.1496,
      "mae_dtheta": 0.0279221348464489,
      "mae_dx": 0.009440316818654537,
      "mae_dy": 0.0051566665060818195,
      "pose_mae_dtheta": 0.2463565170764923,
      "pose_mae_dx": 0.09890902042388916,
      "pose_mae_dy": 0.10285551846027374,
      "pose_rmse_dtheta": 0.4208838939666748,
      "pose_rmse_dx": 0.1933390349149704,
      "pose_rmse_dy": 0.2192438393831253,
      "pose_rmse_mean": 0.27782225608825684,
      "rmse_dtheta": 0.040739044547080994,
      "rmse_dx": 0.021048422902822495,
      "rmse_dy": 0.009273444302380085,
      "rmse_mean": 0.0236869715154171,
      "rotation_flip": 0.0033444815780967474,
      "sparse_tokens": 5394.0,
      "step": 11744,
      "turn_loss": 0.27116304636001587,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5456699498234528,
      "grad_norm": 0.40988588333129883,
      "learning_rate": 1.1453044125114832e-08,
      "loss": 0.1018,
      "mae_dtheta": 0.009340610355138779,
      "mae_dx": 0.0015635078307241201,
      "mae_dy": 0.001985779730603099,
      "pose_mae_dtheta": 0.06212058663368225,
      "pose_mae_dx": 0.013049291446805,
      "pose_mae_dy": 0.019940903410315514,
      "pose_rmse_dtheta": 0.17497394979000092,
      "pose_rmse_dx": 0.031815629452466965,
      "pose_rmse_dy": 0.04505534470081329,
      "pose_rmse_mean": 0.08394831418991089,
      "rmse_dtheta": 0.022059975191950798,
      "rmse_dx": 0.0063698566518723965,
      "rmse_dy": 0.006227036006748676,
      "rmse_mean": 0.011552289128303528,
      "rotation_flip": 0.005484460853040218,
      "sparse_tokens": 32073.0,
      "step": 11745,
      "turn_loss": 0.07949621230363846,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5457164095892957,
      "grad_norm": 0.30109459161758423,
      "learning_rate": 1.1363775819904776e-08,
      "loss": 0.0875,
      "mae_dtheta": 0.0070730457082390785,
      "mae_dx": 0.002010870026424527,
      "mae_dy": 0.0012584906071424484,
      "pose_mae_dtheta": 0.048482634127140045,
      "pose_mae_dx": 0.020228730514645576,
      "pose_mae_dy": 0.014943755231797695,
      "pose_rmse_dtheta": 0.15068888664245605,
      "pose_rmse_dx": 0.051090702414512634,
      "pose_rmse_dy": 0.040448565036058426,
      "pose_rmse_mean": 0.0807427167892456,
      "rmse_dtheta": 0.019483519718050957,
      "rmse_dx": 0.00560712767764926,
      "rmse_dy": 0.003148948308080435,
      "rmse_mean": 0.009413199499249458,
      "rotation_flip": 0.0038517091888934374,
      "sparse_tokens": 32153.0,
      "step": 11746,
      "turn_loss": 0.06361991167068481,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29522.0,
      "epoch": 0.5457628693551384,
      "grad_norm": 0.4907718598842621,
      "learning_rate": 1.1274856372703313e-08,
      "loss": 0.1133,
      "mae_dtheta": 0.021734554320573807,
      "mae_dx": 0.008652587421238422,
      "mae_dy": 0.003137637162581086,
      "pose_mae_dtheta": 0.14440801739692688,
      "pose_mae_dx": 0.06503364443778992,
      "pose_mae_dy": 0.03914262354373932,
      "pose_rmse_dtheta": 0.3213242292404175,
      "pose_rmse_dx": 0.17414066195487976,
      "pose_rmse_dy": 0.10247382521629333,
      "pose_rmse_mean": 0.19931291043758392,
      "rmse_dtheta": 0.04076355695724487,
      "rmse_dx": 0.02073800563812256,
      "rmse_dy": 0.007058970630168915,
      "rmse_mean": 0.022853512316942215,
      "rotation_flip": 0.00872093066573143,
      "sparse_tokens": 24800.0,
      "step": 11747,
      "turn_loss": 0.1673279106616974,
      "turns": 91.0,
      "turns_per_sample": 91.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5458093291209812,
      "grad_norm": 0.5625927448272705,
      "learning_rate": 1.1186285789728247e-08,
      "loss": 0.1292,
      "mae_dtheta": 0.010036374442279339,
      "mae_dx": 0.0014221053570508957,
      "mae_dy": 0.002629521768540144,
      "pose_mae_dtheta": 0.06324750930070877,
      "pose_mae_dx": 0.02272060513496399,
      "pose_mae_dy": 0.026451487094163895,
      "pose_rmse_dtheta": 0.13980820775032043,
      "pose_rmse_dx": 0.07881421595811844,
      "pose_rmse_dy": 0.06342782825231552,
      "pose_rmse_mean": 0.09401675313711166,
      "rmse_dtheta": 0.020478850230574608,
      "rmse_dx": 0.004062616266310215,
      "rmse_dy": 0.006274823565036058,
      "rmse_mean": 0.01027209684252739,
      "rotation_flip": 0.006854531820863485,
      "sparse_tokens": 32089.0,
      "step": 11748,
      "turn_loss": 0.08504483103752136,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.545855788886824,
      "grad_norm": 0.40983864665031433,
      "learning_rate": 1.109806407717462e-08,
      "loss": 0.0762,
      "mae_dtheta": 0.006218406837433577,
      "mae_dx": 0.0009840812999755144,
      "mae_dy": 0.001151132513768971,
      "pose_mae_dtheta": 0.0364360511302948,
      "pose_mae_dx": 0.011789441108703613,
      "pose_mae_dy": 0.015096045099198818,
      "pose_rmse_dtheta": 0.09203276038169861,
      "pose_rmse_dx": 0.034872304648160934,
      "pose_rmse_dy": 0.037932392209768295,
      "pose_rmse_mean": 0.054945822805166245,
      "rmse_dtheta": 0.017652103677392006,
      "rmse_dx": 0.003110177582129836,
      "rmse_dy": 0.002832508645951748,
      "rmse_mean": 0.007864929735660553,
      "rotation_flip": 0.0004242681316100061,
      "sparse_tokens": 32153.0,
      "step": 11749,
      "turn_loss": 0.047143034636974335,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5459022486526668,
      "grad_norm": 0.3812198340892792,
      "learning_rate": 1.1010191241210832e-08,
      "loss": 0.0985,
      "mae_dtheta": 0.013294156640768051,
      "mae_dx": 0.0034113500732928514,
      "mae_dy": 0.0050746421329677105,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3812198340892792,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 157.73651123046875,
      "model/head/act_norm_mean": 95.09449968434343,
      "model/head/act_norm_min": 56.53041076660156,
      "model/head/act_over_embed": 65.34983047181358,
      "model/head/grad_frac": 0.11441909521818161,
      "model/head/grad_norm": 0.0436188280582428,
      "model/head/grad_zero_frac": 0.0001764031039783731,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7062963620580808,
      "model/head/update_ratio": 0.0007425117073580623,
      "model/head/weight_delta": 9.986076354980469,
      "model/head/weight_delta_rel": 0.17518535256385803,
      "model/head/weight_norm": 58.744972229003906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229378402233124,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228687370401122,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42280566692352295,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905993550534557,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10564921796321869,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04027557745575905,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5313274366740088,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013004766078665853,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156928777694702,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314670205116272,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969860076904297,
      "model/modality_embedder/grad_frac": 0.10564921796321869,
      "model/modality_embedder/grad_norm": 0.04027557745575905,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5313274366740088,
      "model/modality_embedder/update_ratio": 0.0013004766078665853,
      "model/modality_embedder/weight_delta": 3.156928777694702,
      "model/modality_embedder/weight_delta_rel": 0.10314670205116272,
      "model/modality_embedder/weight_norm": 30.969860076904297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 87.63538360595703,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.29596310325477,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.081372261047363,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.321994582651973,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07241535931825638,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.027606170624494553,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.000987300300039351,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7429041862487793,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995308518409729,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961271286010742,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 89.82845306396484,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.221360429693764,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.460451126098633,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 15.957936289087119,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07480338215827942,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.028516532853245735,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0009578635799698532,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.47766375541687,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12046898901462555,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77097511291504,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 91.67434692382812,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.048799001924003,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.756278038024902,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.213769184673204,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0704437792301178,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.026854565367102623,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0008735305164009333,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7676656246185303,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12651115655899048,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.74256134033203,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.48096466064453,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.941829004329005,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.338799476623535,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.514677125152033,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07623854279518127,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.029063645750284195,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0009702178067527711,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2387301921844482,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11068442463874817,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955795288085938,
      "model/normalizer/grad_frac": 0.2602129578590393,
      "model/normalizer/grad_norm": 0.0991983413696289,
      "model/normalizer/grad_zero_frac": 0.0002280755143146962,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001261132420040667,
      "model/normalizer/weight_delta": 6.810861110687256,
      "model/normalizer/weight_delta_rel": 0.08771994709968567,
      "model/normalizer/weight_norm": 78.65814971923828,
      "pose_mae_dtheta": 0.0940416231751442,
      "pose_mae_dx": 0.0406491756439209,
      "pose_mae_dy": 0.04233553633093834,
      "pose_rmse_dtheta": 0.19521519541740417,
      "pose_rmse_dx": 0.09584471583366394,
      "pose_rmse_dy": 0.08897510915994644,
      "pose_rmse_mean": 0.12667834758758545,
      "rmse_dtheta": 0.026445016264915466,
      "rmse_dx": 0.009452121332287788,
      "rmse_dy": 0.01043793186545372,
      "rmse_mean": 0.015445022843778133,
      "rotation_flip": 0.007631055079400539,
      "sparse_tokens": 32137.0,
      "step": 11750,
      "turn_loss": 0.15120850503444672,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.5459487084185096,
      "grad_norm": 0.4930306077003479,
      "learning_rate": 1.092266728798197e-08,
      "loss": 0.1437,
      "mae_dtheta": 0.03619873523712158,
      "mae_dx": 0.01474684476852417,
      "mae_dy": 0.016460096463561058,
      "pose_mae_dtheta": 0.312714159488678,
      "pose_mae_dx": 0.0886656641960144,
      "pose_mae_dy": 0.1852329522371292,
      "pose_rmse_dtheta": 0.47839611768722534,
      "pose_rmse_dx": 0.16889531910419464,
      "pose_rmse_dy": 0.32908743619918823,
      "pose_rmse_mean": 0.32545962929725647,
      "rmse_dtheta": 0.05082552880048752,
      "rmse_dx": 0.02570318803191185,
      "rmse_dy": 0.025011153891682625,
      "rmse_mean": 0.033846624195575714,
      "rotation_flip": 0.030612245202064514,
      "sparse_tokens": 6279.0,
      "step": 11751,
      "turn_loss": 0.5358327031135559,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 14942.0,
      "epoch": 0.5459951681843523,
      "grad_norm": 0.4244229197502136,
      "learning_rate": 1.083549222360869e-08,
      "loss": 0.0784,
      "mae_dtheta": 0.03914540633559227,
      "mae_dx": 0.008402345702052116,
      "mae_dy": 0.005565936211496592,
      "pose_mae_dtheta": 0.3019043207168579,
      "pose_mae_dx": 0.06998477131128311,
      "pose_mae_dy": 0.051264747977256775,
      "pose_rmse_dtheta": 0.5196492075920105,
      "pose_rmse_dx": 0.14091549813747406,
      "pose_rmse_dy": 0.12965497374534607,
      "pose_rmse_mean": 0.26340657472610474,
      "rmse_dtheta": 0.058937955647706985,
      "rmse_dx": 0.01731952466070652,
      "rmse_dy": 0.012085583992302418,
      "rmse_mean": 0.029447689652442932,
      "rotation_flip": 0.017711171880364418,
      "sparse_tokens": 12241.0,
      "step": 11752,
      "turn_loss": 0.22559277713298798,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5460416279501952,
      "grad_norm": 0.5289551615715027,
      "learning_rate": 1.0748666054187783e-08,
      "loss": 0.1188,
      "mae_dtheta": 0.013074380345642567,
      "mae_dx": 0.0014289638493210077,
      "mae_dy": 0.0033363746479153633,
      "pose_mae_dtheta": 0.07728548347949982,
      "pose_mae_dx": 0.023934749886393547,
      "pose_mae_dy": 0.03357525169849396,
      "pose_rmse_dtheta": 0.18939875066280365,
      "pose_rmse_dx": 0.055425986647605896,
      "pose_rmse_dy": 0.0714978352189064,
      "pose_rmse_mean": 0.10544085502624512,
      "rmse_dtheta": 0.025934666395187378,
      "rmse_dx": 0.0033383232075721025,
      "rmse_dy": 0.006396382115781307,
      "rmse_mean": 0.011889791116118431,
      "rotation_flip": 0.006189821287989616,
      "sparse_tokens": 32105.0,
      "step": 11753,
      "turn_loss": 0.11722574383020401,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 37313.0,
      "epoch": 0.5460880877160379,
      "grad_norm": 0.4192946255207062,
      "learning_rate": 1.066218878578995e-08,
      "loss": 0.1125,
      "mae_dtheta": 0.03256389871239662,
      "mae_dx": 0.0123075470328331,
      "mae_dy": 0.004096712451428175,
      "pose_mae_dtheta": 0.24012167751789093,
      "pose_mae_dx": 0.10030417144298553,
      "pose_mae_dy": 0.044719304889440536,
      "pose_rmse_dtheta": 0.4565879702568054,
      "pose_rmse_dx": 0.2506943643093109,
      "pose_rmse_dy": 0.10505182296037674,
      "pose_rmse_mean": 0.2707780599594116,
      "rmse_dtheta": 0.05287616699934006,
      "rmse_dx": 0.02595784142613411,
      "rmse_dy": 0.008837039582431316,
      "rmse_mean": 0.02922368422150612,
      "rotation_flip": 0.023086270317435265,
      "sparse_tokens": 28367.0,
      "step": 11754,
      "turn_loss": 0.2570922374725342,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5461345474818807,
      "grad_norm": 0.44982483983039856,
      "learning_rate": 1.0576060424463686e-08,
      "loss": 0.085,
      "mae_dtheta": 0.008491922169923782,
      "mae_dx": 0.0011330676497891545,
      "mae_dy": 0.0012431371724233031,
      "pose_mae_dtheta": 0.061910152435302734,
      "pose_mae_dx": 0.01357445027679205,
      "pose_mae_dy": 0.018191935494542122,
      "pose_rmse_dtheta": 0.2090538740158081,
      "pose_rmse_dx": 0.03680279850959778,
      "pose_rmse_dy": 0.05563295632600784,
      "pose_rmse_mean": 0.10049654543399811,
      "rmse_dtheta": 0.024317853152751923,
      "rmse_dx": 0.0036982682067900896,
      "rmse_dy": 0.0032429108396172523,
      "rmse_mean": 0.010419677942991257,
      "rotation_flip": 0.0039084311574697495,
      "sparse_tokens": 32089.0,
      "step": 11755,
      "turn_loss": 0.054787952452898026,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.5461810072477234,
      "grad_norm": 0.4231994152069092,
      "learning_rate": 1.0490280976231392e-08,
      "loss": 0.1176,
      "mae_dtheta": 0.019439982250332832,
      "mae_dx": 0.006823796778917313,
      "mae_dy": 0.004228090401738882,
      "pose_mae_dtheta": 0.13187216222286224,
      "pose_mae_dx": 0.05517785623669624,
      "pose_mae_dy": 0.039516109973192215,
      "pose_rmse_dtheta": 0.2591589391231537,
      "pose_rmse_dx": 0.16076642274856567,
      "pose_rmse_dy": 0.0936383306980133,
      "pose_rmse_mean": 0.17118790745735168,
      "rmse_dtheta": 0.033076684921979904,
      "rmse_dx": 0.017724046483635902,
      "rmse_dy": 0.008248042315244675,
      "rmse_mean": 0.019682925194501877,
      "rotation_flip": 0.0058823530562222,
      "sparse_tokens": 6666.0,
      "step": 11756,
      "turn_loss": 0.20552444458007812,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5462274670135663,
      "grad_norm": 0.5010031461715698,
      "learning_rate": 1.0404850447091607e-08,
      "loss": 0.0867,
      "mae_dtheta": 0.009202800691127777,
      "mae_dx": 0.0019286390161141753,
      "mae_dy": 0.0029606930911540985,
      "pose_mae_dtheta": 0.0661955326795578,
      "pose_mae_dx": 0.026291564106941223,
      "pose_mae_dy": 0.0336664617061615,
      "pose_rmse_dtheta": 0.13006632030010223,
      "pose_rmse_dx": 0.06498252600431442,
      "pose_rmse_dy": 0.08099161088466644,
      "pose_rmse_mean": 0.09201347827911377,
      "rmse_dtheta": 0.018104858696460724,
      "rmse_dx": 0.006433994043618441,
      "rmse_dy": 0.006916825193911791,
      "rmse_mean": 0.010485226288437843,
      "rotation_flip": 0.007755102124065161,
      "sparse_tokens": 32073.0,
      "step": 11757,
      "turn_loss": 0.0845985859632492,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.546273926779409,
      "grad_norm": 0.4916684329509735,
      "learning_rate": 1.0319768843018995e-08,
      "loss": 0.134,
      "mae_dtheta": 0.005783558823168278,
      "mae_dx": 0.0009503350593149662,
      "mae_dy": 0.001165232970379293,
      "pose_mae_dtheta": 0.03669257462024689,
      "pose_mae_dx": 0.011212009936571121,
      "pose_mae_dy": 0.015076333656907082,
      "pose_rmse_dtheta": 0.08150181174278259,
      "pose_rmse_dx": 0.031490858644247055,
      "pose_rmse_dy": 0.03924311697483063,
      "pose_rmse_mean": 0.05074526369571686,
      "rmse_dtheta": 0.014384024776518345,
      "rmse_dx": 0.003036307170987129,
      "rmse_dy": 0.002806353848427534,
      "rmse_mean": 0.0067422292195260525,
      "rotation_flip": 0.0019249278120696545,
      "sparse_tokens": 32089.0,
      "step": 11758,
      "turn_loss": 0.042483244091272354,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 6518.0,
      "epoch": 0.5463203865452518,
      "grad_norm": 0.6155442595481873,
      "learning_rate": 1.0235036169963241e-08,
      "loss": 0.0917,
      "mae_dtheta": 0.024334948509931564,
      "mae_dx": 0.012509126216173172,
      "mae_dy": 0.0031314471270889044,
      "pose_mae_dtheta": 0.1646883189678192,
      "pose_mae_dx": 0.0947560966014862,
      "pose_mae_dy": 0.0528845489025116,
      "pose_rmse_dtheta": 0.3205117881298065,
      "pose_rmse_dx": 0.22540853917598724,
      "pose_rmse_dy": 0.12119825184345245,
      "pose_rmse_mean": 0.2223728597164154,
      "rmse_dtheta": 0.04287692531943321,
      "rmse_dx": 0.02777119167149067,
      "rmse_dy": 0.006091035436838865,
      "rmse_mean": 0.025579718872904778,
      "rotation_flip": 0.01171875,
      "sparse_tokens": 5517.0,
      "step": 11759,
      "turn_loss": 0.2196185141801834,
      "turns": 20.0,
      "turns_per_sample": 20.0
    },
    {
      "dense_tokens": 9405.0,
      "epoch": 0.5463668463110946,
      "grad_norm": 0.45620325207710266,
      "learning_rate": 1.015065243384905e-08,
      "loss": 0.1108,
      "mae_dtheta": 0.03369378298521042,
      "mae_dx": 0.0166311115026474,
      "mae_dy": 0.005419975612312555,
      "pose_mae_dtheta": 0.2517901062965393,
      "pose_mae_dx": 0.17085589468479156,
      "pose_mae_dy": 0.08510148525238037,
      "pose_rmse_dtheta": 0.47605007886886597,
      "pose_rmse_dx": 0.35534223914146423,
      "pose_rmse_dy": 0.1872754544019699,
      "pose_rmse_mean": 0.33955591917037964,
      "rmse_dtheta": 0.049802254885435104,
      "rmse_dx": 0.03200604394078255,
      "rmse_dy": 0.009313534945249557,
      "rmse_mean": 0.030373945832252502,
      "rotation_flip": 0.007263922598212957,
      "sparse_tokens": 7841.0,
      "step": 11760,
      "turn_loss": 0.2790634334087372,
      "turns": 29.0,
      "turns_per_sample": 29.0
    },
    {
      "dense_tokens": 26201.0,
      "epoch": 0.5464133060769374,
      "grad_norm": 0.4028409719467163,
      "learning_rate": 1.006661764057837e-08,
      "loss": 0.0925,
      "mae_dtheta": 0.03219785913825035,
      "mae_dx": 0.012047718279063702,
      "mae_dy": 0.006344551686197519,
      "pose_mae_dtheta": 0.2745353579521179,
      "pose_mae_dx": 0.10719829052686691,
      "pose_mae_dy": 0.086946040391922,
      "pose_rmse_dtheta": 0.4620702862739563,
      "pose_rmse_dx": 0.24630647897720337,
      "pose_rmse_dy": 0.22485527396202087,
      "pose_rmse_mean": 0.311077356338501,
      "rmse_dtheta": 0.04929177090525627,
      "rmse_dx": 0.025266440585255623,
      "rmse_dy": 0.014345495961606503,
      "rmse_mean": 0.029634570702910423,
      "rotation_flip": 0.009734513238072395,
      "sparse_tokens": 20512.0,
      "step": 11761,
      "turn_loss": 0.2762915790081024,
      "turns": 81.0,
      "turns_per_sample": 81.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.5464597658427801,
      "grad_norm": 0.6444653868675232,
      "learning_rate": 9.98293179602705e-09,
      "loss": 0.1775,
      "mae_dtheta": 0.023665156215429306,
      "mae_dx": 0.012067216448485851,
      "mae_dy": 0.004714521579444408,
      "pose_mae_dtheta": 0.18918029963970184,
      "pose_mae_dx": 0.09727787971496582,
      "pose_mae_dy": 0.07338397204875946,
      "pose_rmse_dtheta": 0.3287826478481293,
      "pose_rmse_dx": 0.26780813932418823,
      "pose_rmse_dy": 0.17565561830997467,
      "pose_rmse_mean": 0.2574154734611511,
      "rmse_dtheta": 0.038591302931308746,
      "rmse_dx": 0.027103466913104057,
      "rmse_dy": 0.00796105619519949,
      "rmse_mean": 0.024551942944526672,
      "rotation_flip": 0.007894736714661121,
      "sparse_tokens": 7774.0,
      "step": 11762,
      "turn_loss": 0.15694491565227509,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.5465062256086229,
      "grad_norm": 0.52055823802948,
      "learning_rate": 9.899594906047637e-09,
      "loss": 0.1049,
      "mae_dtheta": 0.03186735510826111,
      "mae_dx": 0.011264767497777939,
      "mae_dy": 0.003309852909296751,
      "pose_mae_dtheta": 0.25869467854499817,
      "pose_mae_dx": 0.09075898677110672,
      "pose_mae_dy": 0.045061688870191574,
      "pose_rmse_dtheta": 0.4614278972148895,
      "pose_rmse_dx": 0.22042499482631683,
      "pose_rmse_dy": 0.10257567465305328,
      "pose_rmse_mean": 0.26147618889808655,
      "rmse_dtheta": 0.04886007681488991,
      "rmse_dx": 0.024296356365084648,
      "rmse_dy": 0.006113867741078138,
      "rmse_mean": 0.026423431932926178,
      "rotation_flip": 0.0068807341158390045,
      "sparse_tokens": 18585.0,
      "step": 11763,
      "turn_loss": 0.17849363386631012,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5465526853744657,
      "grad_norm": 0.4102814495563507,
      "learning_rate": 9.816606976468245e-09,
      "loss": 0.1332,
      "mae_dtheta": 0.011959963478147984,
      "mae_dx": 0.001806426327675581,
      "mae_dy": 0.0030184313654899597,
      "pose_mae_dtheta": 0.07455553114414215,
      "pose_mae_dx": 0.019306140020489693,
      "pose_mae_dy": 0.027411380782723427,
      "pose_rmse_dtheta": 0.20474782586097717,
      "pose_rmse_dx": 0.04540849104523659,
      "pose_rmse_dy": 0.0609157457947731,
      "pose_rmse_mean": 0.10369068384170532,
      "rmse_dtheta": 0.025909800082445145,
      "rmse_dx": 0.005717981606721878,
      "rmse_dy": 0.007350465282797813,
      "rmse_mean": 0.01299274992197752,
      "rotation_flip": 0.004602235276252031,
      "sparse_tokens": 32153.0,
      "step": 11764,
      "turn_loss": 0.10080808401107788,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 36014.0,
      "epoch": 0.5465991451403085,
      "grad_norm": 0.6042472124099731,
      "learning_rate": 9.733968013091454e-09,
      "loss": 0.1485,
      "mae_dtheta": 0.02959899976849556,
      "mae_dx": 0.013296953402459621,
      "mae_dy": 0.0050522685050964355,
      "pose_mae_dtheta": 0.21652407944202423,
      "pose_mae_dx": 0.10296952724456787,
      "pose_mae_dy": 0.052627868950366974,
      "pose_rmse_dtheta": 0.3676328957080841,
      "pose_rmse_dx": 0.22616270184516907,
      "pose_rmse_dy": 0.1283426284790039,
      "pose_rmse_mean": 0.2407127469778061,
      "rmse_dtheta": 0.04404864087700844,
      "rmse_dx": 0.026208076626062393,
      "rmse_dy": 0.009262114763259888,
      "rmse_mean": 0.026506278663873672,
      "rotation_flip": 0.014898688532412052,
      "sparse_tokens": 27877.0,
      "step": 11765,
      "turn_loss": 0.2636925280094147,
      "turns": 111.0,
      "turns_per_sample": 111.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5466456049061513,
      "grad_norm": 0.524337887763977,
      "learning_rate": 9.651678021697086e-09,
      "loss": 0.1091,
      "mae_dtheta": 0.00997381191700697,
      "mae_dx": 0.0019374582916498184,
      "mae_dy": 0.0030165028292685747,
      "pose_mae_dtheta": 0.06401759386062622,
      "pose_mae_dx": 0.023646272718906403,
      "pose_mae_dy": 0.030683130025863647,
      "pose_rmse_dtheta": 0.13158543407917023,
      "pose_rmse_dx": 0.06511327624320984,
      "pose_rmse_dy": 0.06953966617584229,
      "pose_rmse_mean": 0.08874613046646118,
      "rmse_dtheta": 0.01905715838074684,
      "rmse_dx": 0.0062347641214728355,
      "rmse_dy": 0.00708371726796031,
      "rmse_mean": 0.010791881009936333,
      "rotation_flip": 0.00914526917040348,
      "sparse_tokens": 32089.0,
      "step": 11766,
      "turn_loss": 0.09538750350475311,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.546692064671994,
      "grad_norm": 0.5251243114471436,
      "learning_rate": 9.56973700803887e-09,
      "loss": 0.123,
      "mae_dtheta": 0.0058894893154501915,
      "mae_dx": 0.0011043112026527524,
      "mae_dy": 0.001544462749734521,
      "pose_mae_dtheta": 0.038146428763866425,
      "pose_mae_dx": 0.011660211719572544,
      "pose_mae_dy": 0.015821758657693863,
      "pose_rmse_dtheta": 0.07258573174476624,
      "pose_rmse_dx": 0.030260751023888588,
      "pose_rmse_dy": 0.0366329550743103,
      "pose_rmse_mean": 0.04649314284324646,
      "rmse_dtheta": 0.012708200141787529,
      "rmse_dx": 0.003457052633166313,
      "rmse_dy": 0.004315073601901531,
      "rmse_mean": 0.0068267760798335075,
      "rotation_flip": 0.0027121270541101694,
      "sparse_tokens": 32137.0,
      "step": 11767,
      "turn_loss": 0.05008833482861519,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13646.0,
      "epoch": 0.5467385244378369,
      "grad_norm": 0.41207247972488403,
      "learning_rate": 9.488144977848335e-09,
      "loss": 0.0938,
      "mae_dtheta": 0.01998094469308853,
      "mae_dx": 0.006709177512675524,
      "mae_dy": 0.004481893964111805,
      "pose_mae_dtheta": 0.1347975879907608,
      "pose_mae_dx": 0.04804008826613426,
      "pose_mae_dy": 0.06606746464967728,
      "pose_rmse_dtheta": 0.2544029951095581,
      "pose_rmse_dx": 0.1289130598306656,
      "pose_rmse_dy": 0.15933185815811157,
      "pose_rmse_mean": 0.18088263273239136,
      "rmse_dtheta": 0.032433729618787766,
      "rmse_dx": 0.018841901794075966,
      "rmse_dy": 0.008424617350101471,
      "rmse_mean": 0.019900083541870117,
      "rotation_flip": 0.007429420482367277,
      "sparse_tokens": 10855.0,
      "step": 11768,
      "turn_loss": 0.18127921223640442,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5467849842036796,
      "grad_norm": 0.37846827507019043,
      "learning_rate": 9.406901936829804e-09,
      "loss": 0.0785,
      "mae_dtheta": 0.009483438916504383,
      "mae_dx": 0.0011567320907488465,
      "mae_dy": 0.00199228641577065,
      "pose_mae_dtheta": 0.06508442759513855,
      "pose_mae_dx": 0.012593396008014679,
      "pose_mae_dy": 0.018386801704764366,
      "pose_rmse_dtheta": 0.2029905468225479,
      "pose_rmse_dx": 0.034497421234846115,
      "pose_rmse_dy": 0.04893621802330017,
      "pose_rmse_mean": 0.0954747349023819,
      "rmse_dtheta": 0.025044556707143784,
      "rmse_dx": 0.003663659794256091,
      "rmse_dy": 0.006347165908664465,
      "rmse_mean": 0.011685127392411232,
      "rotation_flip": 0.004197761416435242,
      "sparse_tokens": 32089.0,
      "step": 11769,
      "turn_loss": 0.07557493448257446,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18773.0,
      "epoch": 0.5468314439695224,
      "grad_norm": 0.6372378468513489,
      "learning_rate": 9.3260078906654e-09,
      "loss": 0.1556,
      "mae_dtheta": 0.03063134476542473,
      "mae_dx": 0.0093355942517519,
      "mae_dy": 0.003443317487835884,
      "pose_mae_dtheta": 0.25352486968040466,
      "pose_mae_dx": 0.07763607054948807,
      "pose_mae_dy": 0.04782667011022568,
      "pose_rmse_dtheta": 0.5099737048149109,
      "pose_rmse_dx": 0.20286332070827484,
      "pose_rmse_dy": 0.10924221575260162,
      "pose_rmse_mean": 0.27402642369270325,
      "rmse_dtheta": 0.050854768604040146,
      "rmse_dx": 0.021552670747041702,
      "rmse_dy": 0.006596751045435667,
      "rmse_mean": 0.02633473090827465,
      "rotation_flip": 0.010282776318490505,
      "sparse_tokens": 16008.0,
      "step": 11770,
      "turn_loss": 0.23452159762382507,
      "turns": 58.0,
      "turns_per_sample": 58.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5468779037353652,
      "grad_norm": 0.28743040561676025,
      "learning_rate": 9.24546284501171e-09,
      "loss": 0.0621,
      "mae_dtheta": 0.009181116707623005,
      "mae_dx": 0.0013139672810211778,
      "mae_dy": 0.001894538290798664,
      "pose_mae_dtheta": 0.058064863085746765,
      "pose_mae_dx": 0.016667334362864494,
      "pose_mae_dy": 0.01934005878865719,
      "pose_rmse_dtheta": 0.17305058240890503,
      "pose_rmse_dx": 0.04346189275383949,
      "pose_rmse_dy": 0.04590679332613945,
      "pose_rmse_mean": 0.08747308701276779,
      "rmse_dtheta": 0.022363703697919846,
      "rmse_dx": 0.0034501159097999334,
      "rmse_dy": 0.0045876773074269295,
      "rmse_mean": 0.010133832693099976,
      "rotation_flip": 0.006239600479602814,
      "sparse_tokens": 32105.0,
      "step": 11771,
      "turn_loss": 0.06887642294168472,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.546924363501208,
      "grad_norm": 0.3348909616470337,
      "learning_rate": 9.16526680550145e-09,
      "loss": 0.0703,
      "mae_dtheta": 0.008019348606467247,
      "mae_dx": 0.0010860537877306342,
      "mae_dy": 0.0018573254346847534,
      "pose_mae_dtheta": 0.055824194103479385,
      "pose_mae_dx": 0.014152825810015202,
      "pose_mae_dy": 0.023919474333524704,
      "pose_rmse_dtheta": 0.13712182641029358,
      "pose_rmse_dx": 0.04108297824859619,
      "pose_rmse_dy": 0.05582870915532112,
      "pose_rmse_mean": 0.0780111700296402,
      "rmse_dtheta": 0.01748664677143097,
      "rmse_dx": 0.003745029214769602,
      "rmse_dy": 0.004700782708823681,
      "rmse_mean": 0.00864415243268013,
      "rotation_flip": 0.002973661758005619,
      "sparse_tokens": 32057.0,
      "step": 11772,
      "turn_loss": 0.06430089473724365,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.5469708232670507,
      "grad_norm": 1.132189154624939,
      "learning_rate": 9.085419777743465e-09,
      "loss": 0.2218,
      "mae_dtheta": 0.04019530862569809,
      "mae_dx": 0.010083695873618126,
      "mae_dy": 0.007790430448949337,
      "pose_mae_dtheta": 0.3231582045555115,
      "pose_mae_dx": 0.08684971183538437,
      "pose_mae_dy": 0.07910032570362091,
      "pose_rmse_dtheta": 0.5618008375167847,
      "pose_rmse_dx": 0.206902876496315,
      "pose_rmse_dy": 0.18054872751235962,
      "pose_rmse_mean": 0.31641748547554016,
      "rmse_dtheta": 0.06101992353796959,
      "rmse_dx": 0.021792344748973846,
      "rmse_dy": 0.01788177900016308,
      "rmse_mean": 0.03356468304991722,
      "rotation_flip": 0.0074487896636128426,
      "sparse_tokens": 9628.0,
      "step": 11773,
      "turn_loss": 0.33557966351509094,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.5470172830328935,
      "grad_norm": 0.5214740037918091,
      "learning_rate": 9.005921767319958e-09,
      "loss": 0.1163,
      "mae_dtheta": 0.028492283076047897,
      "mae_dx": 0.013166535645723343,
      "mae_dy": 0.0037632156163454056,
      "pose_mae_dtheta": 0.2402324080467224,
      "pose_mae_dx": 0.10692375898361206,
      "pose_mae_dy": 0.05775045230984688,
      "pose_rmse_dtheta": 0.3975752592086792,
      "pose_rmse_dx": 0.25101494789123535,
      "pose_rmse_dy": 0.1302632987499237,
      "pose_rmse_mean": 0.2596178650856018,
      "rmse_dtheta": 0.043081022799015045,
      "rmse_dx": 0.026697298511862755,
      "rmse_dy": 0.006799367722123861,
      "rmse_mean": 0.02552589774131775,
      "rotation_flip": 0.017924528568983078,
      "sparse_tokens": 20029.0,
      "step": 11774,
      "turn_loss": 0.20937579870224,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.5470637427987363,
      "grad_norm": 0.7738455533981323,
      "learning_rate": 8.926772779792037e-09,
      "loss": 0.205,
      "mae_dtheta": 0.03530479222536087,
      "mae_dx": 0.006932840682566166,
      "mae_dy": 0.0057924659922719,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.773845374584198,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 133.71824645996094,
      "model/head/act_norm_mean": 100.81223366477273,
      "model/head/act_norm_min": 77.06842041015625,
      "model/head/act_over_embed": 69.2791107934335,
      "model/head/grad_frac": 0.12120816856622696,
      "model/head/grad_norm": 0.09379637986421585,
      "model/head/grad_zero_frac": 0.00011961146083194762,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7005504261363636,
      "model/head/update_ratio": 0.0015966707142069936,
      "model/head/weight_delta": 9.98609447479248,
      "model/head/weight_delta_rel": 0.1751856803894043,
      "model/head/weight_norm": 58.744972229003906,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42286914587020874,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42286914587020874,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42286914587020874,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059963600532557,
      "model/modality_embedder.encoders.pose/grad_frac": 0.08153621852397919,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06309642642736435,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0020373493898659945,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156928777694702,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314670205116272,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969860076904297,
      "model/modality_embedder/grad_frac": 0.08153621852397919,
      "model/modality_embedder/grad_norm": 0.06309642642736435,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0020373493898659945,
      "model/modality_embedder/weight_delta": 3.156928777694702,
      "model/modality_embedder/weight_delta_rel": 0.10314670205116272,
      "model/modality_embedder/weight_norm": 30.969860076904297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 70.8341293334961,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.78316507711039,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.250697135925293,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.656804340342298,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07257062196731567,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.056158438324928284,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00023200451687444001,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002008436480537057,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7429144382476807,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995345771312714,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961273193359375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 72.18970489501953,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.55677167884199,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.800540924072266,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.188434039671368,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0676506981253624,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05235118046402931,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0017584636807441711,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.477677345275879,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12046945840120316,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770977020263672,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 74.09729766845703,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.14609825937951,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.19048023223877,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.28063414532663,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.056856222450733185,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.04399792477488518,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024209167168010026,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0014311729464679956,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7676801681518555,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12651164829730988,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742563247680664,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.96896362304688,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.06136701839827,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.198957443237305,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.59682476755295,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05068077892065048,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03921908512711525,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0013092319713905454,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2387449741363525,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11068493127822876,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955795288085938,
      "model/normalizer/grad_frac": 0.21853338181972504,
      "model/normalizer/grad_norm": 0.16911104321479797,
      "model/normalizer/grad_zero_frac": 0.0002410746383247897,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0021499493159353733,
      "model/normalizer/weight_delta": 6.810887813568115,
      "model/normalizer/weight_delta_rel": 0.08772028982639313,
      "model/normalizer/weight_norm": 78.65814971923828,
      "pose_mae_dtheta": 0.302310585975647,
      "pose_mae_dx": 0.08425027132034302,
      "pose_mae_dy": 0.07738803327083588,
      "pose_rmse_dtheta": 0.5059167742729187,
      "pose_rmse_dx": 0.20335964858531952,
      "pose_rmse_dy": 0.17855499684810638,
      "pose_rmse_mean": 0.29594382643699646,
      "rmse_dtheta": 0.05502978712320328,
      "rmse_dx": 0.017761310562491417,
      "rmse_dy": 0.012306460179388523,
      "rmse_mean": 0.028365854173898697,
      "rotation_flip": 0.019672131165862083,
      "sparse_tokens": 5800.0,
      "step": 11775,
      "turn_loss": 0.2817592918872833,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 3602.0,
      "epoch": 0.5471102025645791,
      "grad_norm": 0.4981183111667633,
      "learning_rate": 8.847972820693052e-09,
      "loss": 0.0661,
      "mae_dtheta": 0.019458571448922157,
      "mae_dx": 0.014936268329620361,
      "mae_dy": 0.003892019623890519,
      "pose_mae_dtheta": 0.16753637790679932,
      "pose_mae_dx": 0.11312045156955719,
      "pose_mae_dy": 0.05508096516132355,
      "pose_rmse_dtheta": 0.32669585943222046,
      "pose_rmse_dx": 0.24015262722969055,
      "pose_rmse_dy": 0.1257452815771103,
      "pose_rmse_mean": 0.23086461424827576,
      "rmse_dtheta": 0.03961820527911186,
      "rmse_dx": 0.029420608654618263,
      "rmse_dy": 0.007880441844463348,
      "rmse_mean": 0.02563975378870964,
      "rotation_flip": 0.010101010091602802,
      "sparse_tokens": 3104.0,
      "step": 11776,
      "turn_loss": 0.1684747189283371,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5471566623304218,
      "grad_norm": 0.7889642119407654,
      "learning_rate": 8.769521895534705e-09,
      "loss": 0.1658,
      "mae_dtheta": 0.01436864584684372,
      "mae_dx": 0.0024410244077444077,
      "mae_dy": 0.004840015899389982,
      "pose_mae_dtheta": 0.09703684598207474,
      "pose_mae_dx": 0.044980648905038834,
      "pose_mae_dy": 0.05190028250217438,
      "pose_rmse_dtheta": 0.19543418288230896,
      "pose_rmse_dx": 0.11855457723140717,
      "pose_rmse_dy": 0.10799085348844528,
      "pose_rmse_mean": 0.1406598687171936,
      "rmse_dtheta": 0.025524795055389404,
      "rmse_dx": 0.005589618347585201,
      "rmse_dy": 0.009318032301962376,
      "rmse_mean": 0.01347748190164566,
      "rotation_flip": 0.005516395904123783,
      "sparse_tokens": 32121.0,
      "step": 11777,
      "turn_loss": 0.12817806005477905,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20712.0,
      "epoch": 0.5472031220962646,
      "grad_norm": 0.5554342269897461,
      "learning_rate": 8.69142000980261e-09,
      "loss": 0.1031,
      "mae_dtheta": 0.03511343151330948,
      "mae_dx": 0.011461209505796432,
      "mae_dy": 0.004041007719933987,
      "pose_mae_dtheta": 0.2880094349384308,
      "pose_mae_dx": 0.10082565993070602,
      "pose_mae_dy": 0.05225313827395439,
      "pose_rmse_dtheta": 0.4966972768306732,
      "pose_rmse_dx": 0.24892936646938324,
      "pose_rmse_dy": 0.11828767508268356,
      "pose_rmse_mean": 0.2879714369773865,
      "rmse_dtheta": 0.053438786417245865,
      "rmse_dx": 0.024628879502415657,
      "rmse_dy": 0.007688129786401987,
      "rmse_mean": 0.028585266321897507,
      "rotation_flip": 0.008101851679384708,
      "sparse_tokens": 16636.0,
      "step": 11778,
      "turn_loss": 0.2027415782213211,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.5472495818621074,
      "grad_norm": 0.5130911469459534,
      "learning_rate": 8.613667168958506e-09,
      "loss": 0.106,
      "mae_dtheta": 0.02952222153544426,
      "mae_dx": 0.016497287899255753,
      "mae_dy": 0.0026446692645549774,
      "pose_mae_dtheta": 0.23777684569358826,
      "pose_mae_dx": 0.1309213638305664,
      "pose_mae_dy": 0.013126430101692677,
      "pose_rmse_dtheta": 0.40509194135665894,
      "pose_rmse_dx": 0.26460856199264526,
      "pose_rmse_dy": 0.02499512769281864,
      "pose_rmse_mean": 0.2315652221441269,
      "rmse_dtheta": 0.0463905893266201,
      "rmse_dx": 0.0296542439609766,
      "rmse_dy": 0.005649436730891466,
      "rmse_mean": 0.027231425046920776,
      "rotation_flip": 0.0052083334885537624,
      "sparse_tokens": 3537.0,
      "step": 11779,
      "turn_loss": 0.21226924657821655,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5472960416279502,
      "grad_norm": 0.4325231909751892,
      "learning_rate": 8.536263378439713e-09,
      "loss": 0.0919,
      "mae_dtheta": 0.009881563484668732,
      "mae_dx": 0.0012066996423527598,
      "mae_dy": 0.001845403341576457,
      "pose_mae_dtheta": 0.06547387689352036,
      "pose_mae_dx": 0.013405734673142433,
      "pose_mae_dy": 0.026386700570583344,
      "pose_rmse_dtheta": 0.17942000925540924,
      "pose_rmse_dx": 0.03680185601115227,
      "pose_rmse_dy": 0.056742798537015915,
      "pose_rmse_mean": 0.09098821878433228,
      "rmse_dtheta": 0.021113088354468346,
      "rmse_dx": 0.00418427586555481,
      "rmse_dy": 0.004090733826160431,
      "rmse_mean": 0.009796032682061195,
      "rotation_flip": 0.002973240800201893,
      "sparse_tokens": 32057.0,
      "step": 11780,
      "turn_loss": 0.06830043345689774,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8436.0,
      "epoch": 0.5473425013937929,
      "grad_norm": 0.40264666080474854,
      "learning_rate": 8.459208643659122e-09,
      "loss": 0.0955,
      "mae_dtheta": 0.04055280238389969,
      "mae_dx": 0.013595583848655224,
      "mae_dy": 0.00761458883062005,
      "pose_mae_dtheta": 0.3243238925933838,
      "pose_mae_dx": 0.11077167838811874,
      "pose_mae_dy": 0.07247249037027359,
      "pose_rmse_dtheta": 0.4796144962310791,
      "pose_rmse_dx": 0.21894937753677368,
      "pose_rmse_dy": 0.15298956632614136,
      "pose_rmse_mean": 0.28385114669799805,
      "rmse_dtheta": 0.05424972251057625,
      "rmse_dx": 0.02415832318365574,
      "rmse_dy": 0.01471344381570816,
      "rmse_mean": 0.0310404971241951,
      "rotation_flip": 0.0071090045385062695,
      "sparse_tokens": 6613.0,
      "step": 11781,
      "turn_loss": 0.3999274969100952,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5473889611596358,
      "grad_norm": 0.4549148380756378,
      "learning_rate": 8.382502970005202e-09,
      "loss": 0.1388,
      "mae_dtheta": 0.014210443012416363,
      "mae_dx": 0.004557945765554905,
      "mae_dy": 0.005882590543478727,
      "pose_mae_dtheta": 0.09655293822288513,
      "pose_mae_dx": 0.04173631966114044,
      "pose_mae_dy": 0.0353081189095974,
      "pose_rmse_dtheta": 0.19442422688007355,
      "pose_rmse_dx": 0.10018392652273178,
      "pose_rmse_dy": 0.07182680070400238,
      "pose_rmse_mean": 0.12214498221874237,
      "rmse_dtheta": 0.026901762932538986,
      "rmse_dx": 0.009700492955744267,
      "rmse_dy": 0.011952795088291168,
      "rmse_mean": 0.016185017302632332,
      "rotation_flip": 0.00661489786580205,
      "sparse_tokens": 32185.0,
      "step": 11782,
      "turn_loss": 0.18811668455600739,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15266.0,
      "epoch": 0.5474354209254786,
      "grad_norm": 1.425845980644226,
      "learning_rate": 8.30614636284144e-09,
      "loss": 0.2911,
      "mae_dtheta": 0.021944690495729446,
      "mae_dx": 0.006897987797856331,
      "mae_dy": 0.0037842397578060627,
      "pose_mae_dtheta": 0.12683387100696564,
      "pose_mae_dx": 0.049587033689022064,
      "pose_mae_dy": 0.03484612703323364,
      "pose_rmse_dtheta": 0.24952338635921478,
      "pose_rmse_dx": 0.13151633739471436,
      "pose_rmse_dy": 0.1003989577293396,
      "pose_rmse_mean": 0.1604795753955841,
      "rmse_dtheta": 0.038136620074510574,
      "rmse_dx": 0.0172232948243618,
      "rmse_dy": 0.009977801702916622,
      "rmse_mean": 0.021779239177703857,
      "rotation_flip": 0.019736841320991516,
      "sparse_tokens": 12029.0,
      "step": 11783,
      "turn_loss": 0.21332301199436188,
      "turns": 47.0,
      "turns_per_sample": 47.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5474818806913213,
      "grad_norm": 0.41371461749076843,
      "learning_rate": 8.230138827509115e-09,
      "loss": 0.0863,
      "mae_dtheta": 0.009655969217419624,
      "mae_dx": 0.0018718313658609986,
      "mae_dy": 0.002317903796210885,
      "pose_mae_dtheta": 0.07109246402978897,
      "pose_mae_dx": 0.022898247465491295,
      "pose_mae_dy": 0.021867593750357628,
      "pose_rmse_dtheta": 0.2402552366256714,
      "pose_rmse_dx": 0.07017919421195984,
      "pose_rmse_dy": 0.056152522563934326,
      "pose_rmse_mean": 0.12219565361738205,
      "rmse_dtheta": 0.026710467413067818,
      "rmse_dx": 0.005370193161070347,
      "rmse_dy": 0.005668575409799814,
      "rmse_mean": 0.012583079747855663,
      "rotation_flip": 0.005400539841502905,
      "sparse_tokens": 32073.0,
      "step": 11784,
      "turn_loss": 0.0717189833521843,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5475283404571641,
      "grad_norm": 0.47018754482269287,
      "learning_rate": 8.15448036932176e-09,
      "loss": 0.0968,
      "mae_dtheta": 0.00881033856421709,
      "mae_dx": 0.0011308375978842378,
      "mae_dy": 0.0014247896615415812,
      "pose_mae_dtheta": 0.06551597267389297,
      "pose_mae_dx": 0.015466663055121899,
      "pose_mae_dy": 0.017579207196831703,
      "pose_rmse_dtheta": 0.239824578166008,
      "pose_rmse_dx": 0.043002527207136154,
      "pose_rmse_dy": 0.05894158408045769,
      "pose_rmse_mean": 0.11392289400100708,
      "rmse_dtheta": 0.02622244320809841,
      "rmse_dx": 0.0033481984864920378,
      "rmse_dy": 0.004330179654061794,
      "rmse_mean": 0.01130027323961258,
      "rotation_flip": 0.002960039535537362,
      "sparse_tokens": 32089.0,
      "step": 11785,
      "turn_loss": 0.052210837602615356,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.5475748002230069,
      "grad_norm": 0.6679553389549255,
      "learning_rate": 8.079170993570695e-09,
      "loss": 0.1274,
      "mae_dtheta": 0.02833823300898075,
      "mae_dx": 0.005546380300074816,
      "mae_dy": 0.01280529610812664,
      "pose_mae_dtheta": 0.1590874344110489,
      "pose_mae_dx": 0.0986320748925209,
      "pose_mae_dy": 0.12183938175439835,
      "pose_rmse_dtheta": 0.24774542450904846,
      "pose_rmse_dx": 0.1488528996706009,
      "pose_rmse_dy": 0.20194599032402039,
      "pose_rmse_mean": 0.19951479136943817,
      "rmse_dtheta": 0.039101436734199524,
      "rmse_dx": 0.01131562702357769,
      "rmse_dy": 0.019148962572216988,
      "rmse_mean": 0.023188676685094833,
      "rotation_flip": 0.009852216579020023,
      "sparse_tokens": 2922.0,
      "step": 11786,
      "turn_loss": 0.26011475920677185,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 23617.0,
      "epoch": 0.5476212599888497,
      "grad_norm": 1.0613518953323364,
      "learning_rate": 8.00421070552282e-09,
      "loss": 0.2533,
      "mae_dtheta": 0.03678322583436966,
      "mae_dx": 0.00877150148153305,
      "mae_dy": 0.002364804269745946,
      "pose_mae_dtheta": 0.29329290986061096,
      "pose_mae_dx": 0.06953173130750656,
      "pose_mae_dy": 0.03424447774887085,
      "pose_rmse_dtheta": 0.5422298312187195,
      "pose_rmse_dx": 0.17906180024147034,
      "pose_rmse_dy": 0.08857852220535278,
      "pose_rmse_mean": 0.2699567377567291,
      "rmse_dtheta": 0.05852199345827103,
      "rmse_dx": 0.02041262574493885,
      "rmse_dy": 0.004575520288199186,
      "rmse_mean": 0.027836713939905167,
      "rotation_flip": 0.017435897141695023,
      "sparse_tokens": 17406.0,
      "step": 11787,
      "turn_loss": 0.23005905747413635,
      "turns": 73.0,
      "turns_per_sample": 73.0
    },
    {
      "dense_tokens": 10408.0,
      "epoch": 0.5476677197546924,
      "grad_norm": 0.4514283239841461,
      "learning_rate": 7.929599510420049e-09,
      "loss": 0.1017,
      "mae_dtheta": 0.01997547782957554,
      "mae_dx": 0.010539300739765167,
      "mae_dy": 0.002139057731255889,
      "pose_mae_dtheta": 0.14887507259845734,
      "pose_mae_dx": 0.09035360813140869,
      "pose_mae_dy": 0.030380254611372948,
      "pose_rmse_dtheta": 0.24843084812164307,
      "pose_rmse_dx": 0.1963595300912857,
      "pose_rmse_dy": 0.06489966064691544,
      "pose_rmse_mean": 0.1698966920375824,
      "rmse_dtheta": 0.0354129932820797,
      "rmse_dx": 0.022152381017804146,
      "rmse_dy": 0.0042304652743041515,
      "rmse_mean": 0.02059861458837986,
      "rotation_flip": 0.018018018454313278,
      "sparse_tokens": 8177.0,
      "step": 11788,
      "turn_loss": 0.1861332356929779,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 12026.0,
      "epoch": 0.5477141795205352,
      "grad_norm": 0.3635849356651306,
      "learning_rate": 7.855337413479879e-09,
      "loss": 0.0878,
      "mae_dtheta": 0.021154016256332397,
      "mae_dx": 0.011699292808771133,
      "mae_dy": 0.0021743527613580227,
      "pose_mae_dtheta": 0.16217736899852753,
      "pose_mae_dx": 0.09047107398509979,
      "pose_mae_dy": 0.020376883447170258,
      "pose_rmse_dtheta": 0.3601290285587311,
      "pose_rmse_dx": 0.23488084971904755,
      "pose_rmse_dy": 0.04936771094799042,
      "pose_rmse_mean": 0.21479253470897675,
      "rmse_dtheta": 0.0388932079076767,
      "rmse_dx": 0.024953536689281464,
      "rmse_dy": 0.005077908746898174,
      "rmse_mean": 0.022974884137511253,
      "rotation_flip": 0.005791505798697472,
      "sparse_tokens": 9447.0,
      "step": 11789,
      "turn_loss": 0.1947138011455536,
      "turns": 37.0,
      "turns_per_sample": 37.0
    },
    {
      "dense_tokens": 25310.0,
      "epoch": 0.547760639286378,
      "grad_norm": 0.4824649393558502,
      "learning_rate": 7.781424419894824e-09,
      "loss": 0.1205,
      "mae_dtheta": 0.02061636745929718,
      "mae_dx": 0.009298932738602161,
      "mae_dy": 0.004132190719246864,
      "pose_mae_dtheta": 0.14064456522464752,
      "pose_mae_dx": 0.07765518873929977,
      "pose_mae_dy": 0.06108797714114189,
      "pose_rmse_dtheta": 0.27735981345176697,
      "pose_rmse_dx": 0.21085534989833832,
      "pose_rmse_dy": 0.13122548162937164,
      "pose_rmse_mean": 0.2064802050590515,
      "rmse_dtheta": 0.035803522914648056,
      "rmse_dx": 0.022988498210906982,
      "rmse_dy": 0.008274015970528126,
      "rmse_mean": 0.022355346009135246,
      "rotation_flip": 0.005868544802069664,
      "sparse_tokens": 19504.0,
      "step": 11790,
      "turn_loss": 0.16011570394039154,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5478070990522208,
      "grad_norm": 0.5445812344551086,
      "learning_rate": 7.707860534834632e-09,
      "loss": 0.1534,
      "mae_dtheta": 0.010858828201889992,
      "mae_dx": 0.0025459572207182646,
      "mae_dy": 0.0035371656995266676,
      "pose_mae_dtheta": 0.06677301228046417,
      "pose_mae_dx": 0.02679431065917015,
      "pose_mae_dy": 0.03200463950634003,
      "pose_rmse_dtheta": 0.13676172494888306,
      "pose_rmse_dx": 0.07677256315946579,
      "pose_rmse_dy": 0.08726982027292252,
      "pose_rmse_mean": 0.10026803612709045,
      "rmse_dtheta": 0.023100804537534714,
      "rmse_dx": 0.007749516516923904,
      "rmse_dy": 0.010665626265108585,
      "rmse_mean": 0.013838648796081543,
      "rotation_flip": 0.008366678841412067,
      "sparse_tokens": 32121.0,
      "step": 11791,
      "turn_loss": 0.1214359849691391,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4237.0,
      "epoch": 0.5478535588180635,
      "grad_norm": 1.095321774482727,
      "learning_rate": 7.634645763443527e-09,
      "loss": 0.2219,
      "mae_dtheta": 0.03624428063631058,
      "mae_dx": 0.01687433011829853,
      "mae_dy": 0.006056112237274647,
      "pose_mae_dtheta": 0.2056446373462677,
      "pose_mae_dx": 0.10309422761201859,
      "pose_mae_dy": 0.10003398358821869,
      "pose_rmse_dtheta": 0.32961010932922363,
      "pose_rmse_dx": 0.2254098802804947,
      "pose_rmse_dy": 0.22085511684417725,
      "pose_rmse_mean": 0.2586250305175781,
      "rmse_dtheta": 0.05068793520331383,
      "rmse_dx": 0.03121241182088852,
      "rmse_dy": 0.010754681192338467,
      "rmse_mean": 0.030885009095072746,
      "rotation_flip": 0.013761468231678009,
      "sparse_tokens": 3803.0,
      "step": 11792,
      "turn_loss": 0.23536446690559387,
      "turns": 13.0,
      "turns_per_sample": 13.0
    },
    {
      "dense_tokens": 5222.0,
      "epoch": 0.5479000185839064,
      "grad_norm": 0.35894906520843506,
      "learning_rate": 7.561780110840744e-09,
      "loss": 0.0774,
      "mae_dtheta": 0.011698579415678978,
      "mae_dx": 0.0029350866097956896,
      "mae_dy": 0.0033637466840445995,
      "pose_mae_dtheta": 0.0695742592215538,
      "pose_mae_dx": 0.020032068714499474,
      "pose_mae_dy": 0.024033306166529655,
      "pose_rmse_dtheta": 0.12329761683940887,
      "pose_rmse_dx": 0.053285252302885056,
      "pose_rmse_dy": 0.06526775658130646,
      "pose_rmse_mean": 0.08061687648296356,
      "rmse_dtheta": 0.019824255257844925,
      "rmse_dx": 0.008089269511401653,
      "rmse_dy": 0.007427635602653027,
      "rmse_mean": 0.011780387721955776,
      "rotation_flip": 0.006968641187995672,
      "sparse_tokens": 4293.0,
      "step": 11793,
      "turn_loss": 0.08921223878860474,
      "turns": 16.0,
      "turns_per_sample": 16.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5479464783497491,
      "grad_norm": 0.4473898410797119,
      "learning_rate": 7.489263582122764e-09,
      "loss": 0.1026,
      "mae_dtheta": 0.007981212809681892,
      "mae_dx": 0.002077497774735093,
      "mae_dy": 0.0015269694849848747,
      "pose_mae_dtheta": 0.05311346799135208,
      "pose_mae_dx": 0.025947608053684235,
      "pose_mae_dy": 0.022327259182929993,
      "pose_rmse_dtheta": 0.16021223366260529,
      "pose_rmse_dx": 0.08577651530504227,
      "pose_rmse_dy": 0.06007156893610954,
      "pose_rmse_mean": 0.10202010720968246,
      "rmse_dtheta": 0.021362172439694405,
      "rmse_dx": 0.008024177514016628,
      "rmse_dy": 0.003607475198805332,
      "rmse_mean": 0.010997941717505455,
      "rotation_flip": 0.0005232862313278019,
      "sparse_tokens": 32057.0,
      "step": 11794,
      "turn_loss": 0.0852656438946724,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5479929381155919,
      "grad_norm": 0.4720235764980316,
      "learning_rate": 7.417096182359973e-09,
      "loss": 0.1115,
      "mae_dtheta": 0.010018089786171913,
      "mae_dx": 0.0018372799968346953,
      "mae_dy": 0.003333259141072631,
      "pose_mae_dtheta": 0.0658925324678421,
      "pose_mae_dx": 0.026262154802680016,
      "pose_mae_dy": 0.03453540802001953,
      "pose_rmse_dtheta": 0.1433626413345337,
      "pose_rmse_dx": 0.082392618060112,
      "pose_rmse_dy": 0.0962015688419342,
      "pose_rmse_mean": 0.1073189377784729,
      "rmse_dtheta": 0.02063230238854885,
      "rmse_dx": 0.006081368774175644,
      "rmse_dy": 0.00909376610070467,
      "rmse_mean": 0.01193581335246563,
      "rotation_flip": 0.008316831663250923,
      "sparse_tokens": 32089.0,
      "step": 11795,
      "turn_loss": 0.10329689830541611,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5480393978814346,
      "grad_norm": 0.4956652820110321,
      "learning_rate": 7.345277916599447e-09,
      "loss": 0.1102,
      "mae_dtheta": 0.008098367601633072,
      "mae_dx": 0.0014901607064530253,
      "mae_dy": 0.001975191757082939,
      "pose_mae_dtheta": 0.04855124279856682,
      "pose_mae_dx": 0.014504212886095047,
      "pose_mae_dy": 0.01808187924325466,
      "pose_rmse_dtheta": 0.1485685408115387,
      "pose_rmse_dx": 0.03372592478990555,
      "pose_rmse_dy": 0.042870111763477325,
      "pose_rmse_mean": 0.07505485415458679,
      "rmse_dtheta": 0.019875574856996536,
      "rmse_dx": 0.004407769534736872,
      "rmse_dy": 0.0043408931232988834,
      "rmse_mean": 0.009541412815451622,
      "rotation_flip": 0.0110941082239151,
      "sparse_tokens": 32169.0,
      "step": 11796,
      "turn_loss": 0.07542946189641953,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5480858576472775,
      "grad_norm": 0.45021679997444153,
      "learning_rate": 7.273808789862724e-09,
      "loss": 0.0958,
      "mae_dtheta": 0.010815740562975407,
      "mae_dx": 0.0017725919606164098,
      "mae_dy": 0.002445625141263008,
      "pose_mae_dtheta": 0.07365916669368744,
      "pose_mae_dx": 0.017933545634150505,
      "pose_mae_dy": 0.022773312404751778,
      "pose_rmse_dtheta": 0.21713361144065857,
      "pose_rmse_dx": 0.049705881625413895,
      "pose_rmse_dy": 0.0541841946542263,
      "pose_rmse_mean": 0.10700790584087372,
      "rmse_dtheta": 0.02681581676006317,
      "rmse_dx": 0.004931113217025995,
      "rmse_dy": 0.006181000266224146,
      "rmse_mean": 0.012642644345760345,
      "rotation_flip": 0.0039385585114359856,
      "sparse_tokens": 32137.0,
      "step": 11797,
      "turn_loss": 0.09000376611948013,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29846.0,
      "epoch": 0.5481323174131202,
      "grad_norm": 1.093899130821228,
      "learning_rate": 7.2026888071491385e-09,
      "loss": 0.2502,
      "mae_dtheta": 0.03743609040975571,
      "mae_dx": 0.01039805170148611,
      "mae_dy": 0.0038346725050359964,
      "pose_mae_dtheta": 0.30577269196510315,
      "pose_mae_dx": 0.0688815489411354,
      "pose_mae_dy": 0.03838668763637543,
      "pose_rmse_dtheta": 0.5316057801246643,
      "pose_rmse_dx": 0.16973263025283813,
      "pose_rmse_dy": 0.09340664744377136,
      "pose_rmse_mean": 0.2649150490760803,
      "rmse_dtheta": 0.05602546036243439,
      "rmse_dx": 0.02183455415070057,
      "rmse_dy": 0.008858699351549149,
      "rmse_mean": 0.028906237334012985,
      "rotation_flip": 0.01189643144607544,
      "sparse_tokens": 23276.0,
      "step": 11798,
      "turn_loss": 0.24615605175495148,
      "turns": 92.0,
      "turns_per_sample": 92.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.548178777178963,
      "grad_norm": 0.33198127150535583,
      "learning_rate": 7.131917973430824e-09,
      "loss": 0.0872,
      "mae_dtheta": 0.007335036993026733,
      "mae_dx": 0.0011258515296503901,
      "mae_dy": 0.001356773660518229,
      "pose_mae_dtheta": 0.04475759342312813,
      "pose_mae_dx": 0.013131977990269661,
      "pose_mae_dy": 0.020671654492616653,
      "pose_rmse_dtheta": 0.10930155217647552,
      "pose_rmse_dx": 0.03592892736196518,
      "pose_rmse_dy": 0.06059642881155014,
      "pose_rmse_mean": 0.06860896944999695,
      "rmse_dtheta": 0.01711234822869301,
      "rmse_dx": 0.0033366880379617214,
      "rmse_dy": 0.0032945137936621904,
      "rmse_mean": 0.00791451707482338,
      "rotation_flip": 0.003927343990653753,
      "sparse_tokens": 32121.0,
      "step": 11799,
      "turn_loss": 0.06359696388244629,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5482252369448058,
      "grad_norm": 0.617088258266449,
      "learning_rate": 7.061496293657711e-09,
      "loss": 0.1505,
      "mae_dtheta": 0.005505915731191635,
      "mae_dx": 0.0011116841342300177,
      "mae_dy": 0.0011762174544855952,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6170881390571594,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 168.99098205566406,
      "model/head/act_norm_mean": 120.88223050820707,
      "model/head/act_norm_min": 67.26220703125,
      "model/head/act_over_embed": 83.07140052251242,
      "model/head/grad_frac": 0.09935766458511353,
      "model/head/grad_norm": 0.06131243705749512,
      "model/head/grad_zero_frac": 0.00014245502825360745,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7064344618055556,
      "model/head/update_ratio": 0.0010437051532790065,
      "model/head/weight_delta": 9.98610782623291,
      "model/head/weight_delta_rel": 0.1751859039068222,
      "model/head/weight_norm": 58.74497604370117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.422934353351593,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42287079133599054,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42279574275016785,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2906007667848159,
      "model/modality_embedder.encoders.pose/grad_frac": 0.046791184693574905,
      "model/modality_embedder.encoders.pose/grad_norm": 0.028874285519123077,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5388327205882353,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0009323350386694074,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569323539733887,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314682126045227,
      "model/modality_embedder.encoders.pose/weight_norm": 30.969860076904297,
      "model/modality_embedder/grad_frac": 0.046791184693574905,
      "model/modality_embedder/grad_norm": 0.028874285519123077,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5388327205882353,
      "model/modality_embedder/update_ratio": 0.0009323350386694074,
      "model/modality_embedder/weight_delta": 3.1569323539733887,
      "model/modality_embedder/weight_delta_rel": 0.10314682126045227,
      "model/modality_embedder/weight_norm": 30.969860076904297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 94.55850982666016,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.645843354176687,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.899995803833008,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.936854291011038,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10116107761859894,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.06242530047893524,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00015130729298107326,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0022325627505779266,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.742922782897949,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995376318693161,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961275100708008,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 95.784912109375,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.63785674202341,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.032838821411133,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.618575178514966,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0894632413983345,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05520670488476753,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00017652517999522388,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0018543798942118883,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4776883125305176,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.1204698383808136,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770978927612305,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 97.2319107055664,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 27.438847803431138,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.208150863647461,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.856233097058325,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08133740723133087,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.050192348659038544,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0016326660988852382,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.767693281173706,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1265120804309845,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742568969726562,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 97.99053955078125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 29.089027677569344,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 11.90597152709961,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.990252155793492,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0681154653429985,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.04203324392437935,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014031754108145833,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.238758087158203,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11068537831306458,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.955801010131836,
      "model/normalizer/grad_frac": 0.2963159680366516,
      "model/normalizer/grad_norm": 0.1828530728816986,
      "model/normalizer/grad_zero_frac": 0.00017962424317374825,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002324654720723629,
      "model/normalizer/weight_delta": 6.810911178588867,
      "model/normalizer/weight_delta_rel": 0.0877205953001976,
      "model/normalizer/weight_norm": 78.65816497802734,
      "pose_mae_dtheta": 0.035229455679655075,
      "pose_mae_dx": 0.013136550784111023,
      "pose_mae_dy": 0.015350704081356525,
      "pose_rmse_dtheta": 0.09129499644041061,
      "pose_rmse_dx": 0.03749997913837433,
      "pose_rmse_dy": 0.038939591497182846,
      "pose_rmse_mean": 0.05591152235865593,
      "rmse_dtheta": 0.014633926562964916,
      "rmse_dx": 0.0037883431650698185,
      "rmse_dy": 0.002902902662754059,
      "rmse_mean": 0.007108391262590885,
      "rotation_flip": 0.0051282052882015705,
      "sparse_tokens": 32089.0,
      "step": 11800,
      "turn_loss": 0.04189188778400421,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "epoch": 0.5482252369448058,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.29997944831848145,
      "eval_objectnav_nopose_mae_dtheta": 0.03919072449207306,
      "eval_objectnav_nopose_mae_dx": 0.012889169156551361,
      "eval_objectnav_nopose_mae_dy": 0.00496076000854373,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3141302764415741,
      "eval_objectnav_nopose_pose_mae_dx": 0.10287928581237793,
      "eval_objectnav_nopose_pose_mae_dy": 0.05433090403676033,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5343935489654541,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22822429239749908,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12812398374080658,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2969139516353607,
      "eval_objectnav_nopose_rmse_dtheta": 0.05714027211070061,
      "eval_objectnav_nopose_rmse_dx": 0.025554900988936424,
      "eval_objectnav_nopose_rmse_dy": 0.010282021947205067,
      "eval_objectnav_nopose_rmse_mean": 0.030992399901151657,
      "eval_objectnav_nopose_rotation_flip": 0.016574259847402573,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.29997944831848145,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 11800
    },
    {
      "epoch": 0.5482252369448058,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2670368254184723,
      "eval_objectnav_pose_mae_dtheta": 0.03552886098623276,
      "eval_objectnav_pose_mae_dx": 0.01092733908444643,
      "eval_objectnav_pose_mae_dy": 0.004663287661969662,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26518934965133667,
      "eval_objectnav_pose_pose_mae_dx": 0.08505403995513916,
      "eval_objectnav_pose_pose_mae_dy": 0.04812343791127205,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.47144126892089844,
      "eval_objectnav_pose_pose_rmse_dx": 0.19960008561611176,
      "eval_objectnav_pose_pose_rmse_dy": 0.11596276611089706,
      "eval_objectnav_pose_pose_rmse_mean": 0.2623347043991089,
      "eval_objectnav_pose_rmse_dtheta": 0.05365585535764694,
      "eval_objectnav_pose_rmse_dx": 0.02298431470990181,
      "eval_objectnav_pose_rmse_dy": 0.009833693504333496,
      "eval_objectnav_pose_rmse_mean": 0.02882462367415428,
      "eval_objectnav_pose_rotation_flip": 0.015439849346876144,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2670368254184723,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 11800
    },
    {
      "epoch": 0.5482252369448058,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08694899827241898,
      "eval_pointnav_mae_dtheta": 0.009874857030808926,
      "eval_pointnav_mae_dx": 0.0021480487193912268,
      "eval_pointnav_mae_dy": 0.0022884656209498644,
      "eval_pointnav_pose_mae_dtheta": 0.06710043549537659,
      "eval_pointnav_pose_mae_dx": 0.023556480184197426,
      "eval_pointnav_pose_mae_dy": 0.023821964859962463,
      "eval_pointnav_pose_rmse_dtheta": 0.19759421050548553,
      "eval_pointnav_pose_rmse_dx": 0.07387193292379379,
      "eval_pointnav_pose_rmse_dy": 0.06964587420225143,
      "eval_pointnav_pose_rmse_mean": 0.11370401084423065,
      "eval_pointnav_rmse_dtheta": 0.024915454909205437,
      "eval_pointnav_rmse_dx": 0.007009327411651611,
      "eval_pointnav_rmse_dy": 0.0061910138465464115,
      "eval_pointnav_rmse_mean": 0.01270526647567749,
      "eval_pointnav_rotation_flip": 0.004960216581821442,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08694899827241898,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 11800
    },
    {
      "epoch": 0.5482252369448058,
      "eval_loss": 0.21798842400312424,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.29997944831848145,
      "eval_objectnav_nopose_mae_dtheta": 0.03919072449207306,
      "eval_objectnav_nopose_mae_dx": 0.012889169156551361,
      "eval_objectnav_nopose_mae_dy": 0.00496076000854373,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3141302764415741,
      "eval_objectnav_nopose_pose_mae_dx": 0.10287928581237793,
      "eval_objectnav_nopose_pose_mae_dy": 0.05433090403676033,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5343935489654541,
      "eval_objectnav_nopose_pose_rmse_dx": 0.22822429239749908,
      "eval_objectnav_nopose_pose_rmse_dy": 0.12812398374080658,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2969139516353607,
      "eval_objectnav_nopose_rmse_dtheta": 0.05714027211070061,
      "eval_objectnav_nopose_rmse_dx": 0.025554900988936424,
      "eval_objectnav_nopose_rmse_dy": 0.010282021947205067,
      "eval_objectnav_nopose_rmse_mean": 0.030992399901151657,
      "eval_objectnav_nopose_rotation_flip": 0.016574259847402573,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.29997944831848145,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2670368254184723,
      "eval_objectnav_pose_mae_dtheta": 0.03552886098623276,
      "eval_objectnav_pose_mae_dx": 0.01092733908444643,
      "eval_objectnav_pose_mae_dy": 0.004663287661969662,
      "eval_objectnav_pose_pose_mae_dtheta": 0.26518934965133667,
      "eval_objectnav_pose_pose_mae_dx": 0.08505403995513916,
      "eval_objectnav_pose_pose_mae_dy": 0.04812343791127205,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.47144126892089844,
      "eval_objectnav_pose_pose_rmse_dx": 0.19960008561611176,
      "eval_objectnav_pose_pose_rmse_dy": 0.11596276611089706,
      "eval_objectnav_pose_pose_rmse_mean": 0.2623347043991089,
      "eval_objectnav_pose_rmse_dtheta": 0.05365585535764694,
      "eval_objectnav_pose_rmse_dx": 0.02298431470990181,
      "eval_objectnav_pose_rmse_dy": 0.009833693504333496,
      "eval_objectnav_pose_rmse_mean": 0.02882462367415428,
      "eval_objectnav_pose_rotation_flip": 0.015439849346876144,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2670368254184723,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08694899827241898,
      "eval_pointnav_mae_dtheta": 0.009874857030808926,
      "eval_pointnav_mae_dx": 0.0021480487193912268,
      "eval_pointnav_mae_dy": 0.0022884656209498644,
      "eval_pointnav_pose_mae_dtheta": 0.06710043549537659,
      "eval_pointnav_pose_mae_dx": 0.023556480184197426,
      "eval_pointnav_pose_mae_dy": 0.023821964859962463,
      "eval_pointnav_pose_rmse_dtheta": 0.19759421050548553,
      "eval_pointnav_pose_rmse_dx": 0.07387193292379379,
      "eval_pointnav_pose_rmse_dy": 0.06964587420225143,
      "eval_pointnav_pose_rmse_mean": 0.11370401084423065,
      "eval_pointnav_rmse_dtheta": 0.024915454909205437,
      "eval_pointnav_rmse_dx": 0.007009327411651611,
      "eval_pointnav_rmse_dy": 0.0061910138465464115,
      "eval_pointnav_rmse_mean": 0.01270526647567749,
      "eval_pointnav_rotation_flip": 0.004960216581821442,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08694899827241898,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 11800
    },
    {
      "dense_tokens": 4574.0,
      "epoch": 0.5482716967106486,
      "grad_norm": 0.8449844121932983,
      "learning_rate": 6.991423772753636e-09,
      "loss": 0.2181,
      "mae_dtheta": 0.021516645327210426,
      "mae_dx": 0.010929936543107033,
      "mae_dy": 0.0035360329784452915,
      "pose_mae_dtheta": 0.14189662039279938,
      "pose_mae_dx": 0.10477112978696823,
      "pose_mae_dy": 0.036031946539878845,
      "pose_rmse_dtheta": 0.28493228554725647,
      "pose_rmse_dx": 0.22850292921066284,
      "pose_rmse_dy": 0.07429445534944534,
      "pose_rmse_mean": 0.19590990245342255,
      "rmse_dtheta": 0.03821508213877678,
      "rmse_dx": 0.023539504036307335,
      "rmse_dy": 0.0067186481319367886,
      "rmse_mean": 0.02282441221177578,
      "rotation_flip": 0.022421523928642273,
      "sparse_tokens": 3750.0,
      "step": 11801,
      "turn_loss": 0.21194419264793396,
      "turns": 14.0,
      "turns_per_sample": 14.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.5483181564764914,
      "grad_norm": 0.7204864025115967,
      "learning_rate": 6.921700415619681e-09,
      "loss": 0.1262,
      "mae_dtheta": 0.027248552069067955,
      "mae_dx": 0.008282234892249107,
      "mae_dy": 0.006475830916315317,
      "pose_mae_dtheta": 0.21181528270244598,
      "pose_mae_dx": 0.06423614174127579,
      "pose_mae_dy": 0.0548243448138237,
      "pose_rmse_dtheta": 0.40730735659599304,
      "pose_rmse_dx": 0.17373354732990265,
      "pose_rmse_dy": 0.11513378471136093,
      "pose_rmse_mean": 0.23205822706222534,
      "rmse_dtheta": 0.045033060014247894,
      "rmse_dx": 0.019660290330648422,
      "rmse_dy": 0.013490522280335426,
      "rmse_mean": 0.0260612890124321,
      "rotation_flip": 0.012406948022544384,
      "sparse_tokens": 6739.0,
      "step": 11802,
      "turn_loss": 0.25212985277175903,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.5483646162423341,
      "grad_norm": 0.5682518482208252,
      "learning_rate": 6.852326227130835e-09,
      "loss": 0.1107,
      "mae_dtheta": 0.008593368344008923,
      "mae_dx": 0.0028628797736018896,
      "mae_dy": 0.0022227619774639606,
      "pose_mae_dtheta": 0.06215519830584526,
      "pose_mae_dx": 0.023133445531129837,
      "pose_mae_dy": 0.019833961501717567,
      "pose_rmse_dtheta": 0.17677316069602966,
      "pose_rmse_dx": 0.05609625577926636,
      "pose_rmse_dy": 0.05143023654818535,
      "pose_rmse_mean": 0.09476654976606369,
      "rmse_dtheta": 0.021633777767419815,
      "rmse_dx": 0.008883943781256676,
      "rmse_dy": 0.006600212771445513,
      "rmse_mean": 0.012372645549476147,
      "rotation_flip": 0.00409683445468545,
      "sparse_tokens": 32201.0,
      "step": 11803,
      "turn_loss": 0.10306548327207565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.548411076008177,
      "grad_norm": 0.4932422637939453,
      "learning_rate": 6.783301212138771e-09,
      "loss": 0.0729,
      "mae_dtheta": 0.009151090867817402,
      "mae_dx": 0.0019157816423103213,
      "mae_dy": 0.0021577191073447466,
      "pose_mae_dtheta": 0.06406430900096893,
      "pose_mae_dx": 0.022737562656402588,
      "pose_mae_dy": 0.0255306214094162,
      "pose_rmse_dtheta": 0.1530419886112213,
      "pose_rmse_dx": 0.06039473041892052,
      "pose_rmse_dy": 0.060176119208335876,
      "pose_rmse_mean": 0.09120428562164307,
      "rmse_dtheta": 0.020932385697960854,
      "rmse_dx": 0.005839639808982611,
      "rmse_dy": 0.004803935065865517,
      "rmse_mean": 0.010525321587920189,
      "rotation_flip": 0.003674781881272793,
      "sparse_tokens": 32073.0,
      "step": 11804,
      "turn_loss": 0.08098502457141876,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10085.0,
      "epoch": 0.5484575357740197,
      "grad_norm": 0.7448682188987732,
      "learning_rate": 6.71462537547074e-09,
      "loss": 0.161,
      "mae_dtheta": 0.0385715626180172,
      "mae_dx": 0.015211652964353561,
      "mae_dy": 0.004216380883008242,
      "pose_mae_dtheta": 0.3327857553958893,
      "pose_mae_dx": 0.12962797284126282,
      "pose_mae_dy": 0.03635183721780777,
      "pose_rmse_dtheta": 0.5750426650047302,
      "pose_rmse_dx": 0.2873426675796509,
      "pose_rmse_dy": 0.076415054500103,
      "pose_rmse_mean": 0.31293347477912903,
      "rmse_dtheta": 0.056572385132312775,
      "rmse_dx": 0.028236117213964462,
      "rmse_dy": 0.008362156338989735,
      "rmse_mean": 0.031056886538863182,
      "rotation_flip": 0.017699114978313446,
      "sparse_tokens": 7990.0,
      "step": 11805,
      "turn_loss": 0.21092472970485687,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.5485039955398625,
      "grad_norm": 0.5127591490745544,
      "learning_rate": 6.646298721928457e-09,
      "loss": 0.0658,
      "mae_dtheta": 0.031665951013565063,
      "mae_dx": 0.009390139952301979,
      "mae_dy": 0.004762481432408094,
      "pose_mae_dtheta": 0.21917690336704254,
      "pose_mae_dx": 0.06028931960463524,
      "pose_mae_dy": 0.06476566195487976,
      "pose_rmse_dtheta": 0.39109715819358826,
      "pose_rmse_dx": 0.15694519877433777,
      "pose_rmse_dy": 0.14131630957126617,
      "pose_rmse_mean": 0.229786217212677,
      "rmse_dtheta": 0.050045356154441833,
      "rmse_dx": 0.021637529134750366,
      "rmse_dy": 0.0081217335537076,
      "rmse_mean": 0.02660154178738594,
      "rotation_flip": 0.017094017937779427,
      "sparse_tokens": 6320.0,
      "step": 11806,
      "turn_loss": 0.2673388719558716,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 16189.0,
      "epoch": 0.5485504553057052,
      "grad_norm": 1.452743649482727,
      "learning_rate": 6.578321256291431e-09,
      "loss": 0.2155,
      "mae_dtheta": 0.02196531556546688,
      "mae_dx": 0.010231656953692436,
      "mae_dy": 0.004022329114377499,
      "pose_mae_dtheta": 0.17684321105480194,
      "pose_mae_dx": 0.08246836066246033,
      "pose_mae_dy": 0.06208004429936409,
      "pose_rmse_dtheta": 0.3162573277950287,
      "pose_rmse_dx": 0.21774667501449585,
      "pose_rmse_dy": 0.14335033297538757,
      "pose_rmse_mean": 0.2257847785949707,
      "rmse_dtheta": 0.034157730638980865,
      "rmse_dx": 0.024131793528795242,
      "rmse_dy": 0.006940096616744995,
      "rmse_mean": 0.021743208169937134,
      "rotation_flip": 0.01092896144837141,
      "sparse_tokens": 12488.0,
      "step": 11807,
      "turn_loss": 0.17913320660591125,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.5485969150715481,
      "grad_norm": 0.4278448224067688,
      "learning_rate": 6.510692983311973e-09,
      "loss": 0.1182,
      "mae_dtheta": 0.03371104970574379,
      "mae_dx": 0.012916069477796555,
      "mae_dy": 0.005027840379625559,
      "pose_mae_dtheta": 0.23177409172058105,
      "pose_mae_dx": 0.1172855794429779,
      "pose_mae_dy": 0.05599183589220047,
      "pose_rmse_dtheta": 0.43229249119758606,
      "pose_rmse_dx": 0.2645229995250702,
      "pose_rmse_dy": 0.1056407168507576,
      "pose_rmse_mean": 0.2674854099750519,
      "rmse_dtheta": 0.05105704441666603,
      "rmse_dx": 0.026401355862617493,
      "rmse_dy": 0.00830225832760334,
      "rmse_mean": 0.02858688496053219,
      "rotation_flip": 0.011345218867063522,
      "sparse_tokens": 20963.0,
      "step": 11808,
      "turn_loss": 0.2495279312133789,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 11666.0,
      "epoch": 0.5486433748373908,
      "grad_norm": 0.4348895251750946,
      "learning_rate": 6.4434139077201865e-09,
      "loss": 0.0809,
      "mae_dtheta": 0.028003785759210587,
      "mae_dx": 0.014018576592206955,
      "mae_dy": 0.0039015200454741716,
      "pose_mae_dtheta": 0.21590803563594818,
      "pose_mae_dx": 0.13484205305576324,
      "pose_mae_dy": 0.052952591329813004,
      "pose_rmse_dtheta": 0.37137556076049805,
      "pose_rmse_dx": 0.2983402609825134,
      "pose_rmse_dy": 0.10442022234201431,
      "pose_rmse_mean": 0.25804537534713745,
      "rmse_dtheta": 0.04281292483210564,
      "rmse_dx": 0.028980402275919914,
      "rmse_dy": 0.006777599453926086,
      "rmse_mean": 0.02619030885398388,
      "rotation_flip": 0.009411764331161976,
      "sparse_tokens": 9709.0,
      "step": 11809,
      "turn_loss": 0.22809992730617523,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5486898346032336,
      "grad_norm": 0.29330989718437195,
      "learning_rate": 6.376484034220087e-09,
      "loss": 0.0793,
      "mae_dtheta": 0.006910254247486591,
      "mae_dx": 0.0010599381057545543,
      "mae_dy": 0.001540768425911665,
      "pose_mae_dtheta": 0.04580049589276314,
      "pose_mae_dx": 0.013137824833393097,
      "pose_mae_dy": 0.022534063085913658,
      "pose_rmse_dtheta": 0.10324514657258987,
      "pose_rmse_dx": 0.03567827492952347,
      "pose_rmse_dy": 0.06683159619569778,
      "pose_rmse_mean": 0.06858500838279724,
      "rmse_dtheta": 0.01466596033424139,
      "rmse_dx": 0.0033062323927879333,
      "rmse_dy": 0.004059096332639456,
      "rmse_mean": 0.00734376348555088,
      "rotation_flip": 0.006779660936444998,
      "sparse_tokens": 32121.0,
      "step": 11810,
      "turn_loss": 0.056220971047878265,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5852.0,
      "epoch": 0.5487362943690763,
      "grad_norm": 0.6128543019294739,
      "learning_rate": 6.309903367493486e-09,
      "loss": 0.1558,
      "mae_dtheta": 0.0293940007686615,
      "mae_dx": 0.009762567467987537,
      "mae_dy": 0.0042232791893184185,
      "pose_mae_dtheta": 0.21811462938785553,
      "pose_mae_dx": 0.06957852840423584,
      "pose_mae_dy": 0.03155813738703728,
      "pose_rmse_dtheta": 0.3875372111797333,
      "pose_rmse_dx": 0.17388233542442322,
      "pose_rmse_dy": 0.07756703346967697,
      "pose_rmse_mean": 0.2129955291748047,
      "rmse_dtheta": 0.04522959515452385,
      "rmse_dx": 0.021149786189198494,
      "rmse_dy": 0.009396571666002274,
      "rmse_mean": 0.02525865100324154,
      "rotation_flip": 0.013651876710355282,
      "sparse_tokens": 4932.0,
      "step": 11811,
      "turn_loss": 0.23308998346328735,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5487827541349192,
      "grad_norm": 0.40900281071662903,
      "learning_rate": 6.243671912194993e-09,
      "loss": 0.1161,
      "mae_dtheta": 0.00883860420435667,
      "mae_dx": 0.0012528746156021953,
      "mae_dy": 0.0016895812004804611,
      "pose_mae_dtheta": 0.05599801987409592,
      "pose_mae_dx": 0.013749323785305023,
      "pose_mae_dy": 0.02041705697774887,
      "pose_rmse_dtheta": 0.14911967515945435,
      "pose_rmse_dx": 0.032870981842279434,
      "pose_rmse_dy": 0.05181649699807167,
      "pose_rmse_mean": 0.07793571799993515,
      "rmse_dtheta": 0.021248148754239082,
      "rmse_dx": 0.003813671413809061,
      "rmse_dy": 0.0034890365786850452,
      "rmse_mean": 0.009516952559351921,
      "rotation_flip": 0.006048386916518211,
      "sparse_tokens": 32121.0,
      "step": 11812,
      "turn_loss": 0.07006274163722992,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5488292139007619,
      "grad_norm": 0.27453991770744324,
      "learning_rate": 6.177789672957568e-09,
      "loss": 0.0604,
      "mae_dtheta": 0.007050434127449989,
      "mae_dx": 0.001339333481155336,
      "mae_dy": 0.0016515690367668867,
      "pose_mae_dtheta": 0.0478786863386631,
      "pose_mae_dx": 0.01556272991001606,
      "pose_mae_dy": 0.016937589272856712,
      "pose_rmse_dtheta": 0.14827804267406464,
      "pose_rmse_dx": 0.05000396817922592,
      "pose_rmse_dy": 0.03846419230103493,
      "pose_rmse_mean": 0.07891540229320526,
      "rmse_dtheta": 0.019503366202116013,
      "rmse_dx": 0.0053540850058197975,
      "rmse_dy": 0.004783196374773979,
      "rmse_mean": 0.009880215860903263,
      "rotation_flip": 0.0019083969527855515,
      "sparse_tokens": 32105.0,
      "step": 11813,
      "turn_loss": 0.07597340643405914,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.5488756736666047,
      "grad_norm": 0.500559389591217,
      "learning_rate": 6.112256654386972e-09,
      "loss": 0.0998,
      "mae_dtheta": 0.011358942836523056,
      "mae_dx": 0.0030071984510868788,
      "mae_dy": 0.002849042182788253,
      "pose_mae_dtheta": 0.08824648708105087,
      "pose_mae_dx": 0.03748228773474693,
      "pose_mae_dy": 0.033618245273828506,
      "pose_rmse_dtheta": 0.21569271385669708,
      "pose_rmse_dx": 0.12154616415500641,
      "pose_rmse_dy": 0.08931734412908554,
      "pose_rmse_mean": 0.14218541979789734,
      "rmse_dtheta": 0.025822317227721214,
      "rmse_dx": 0.009495344944298267,
      "rmse_dy": 0.00796923041343689,
      "rmse_mean": 0.01442896481603384,
      "rotation_flip": 0.0026867275591939688,
      "sparse_tokens": 32025.0,
      "step": 11814,
      "turn_loss": 0.11493749171495438,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5489221334324474,
      "grad_norm": 0.3918439745903015,
      "learning_rate": 6.0470728610673155e-09,
      "loss": 0.0776,
      "mae_dtheta": 0.009291587397456169,
      "mae_dx": 0.001462580170482397,
      "mae_dy": 0.0018598467577248812,
      "pose_mae_dtheta": 0.06092455983161926,
      "pose_mae_dx": 0.013810711912810802,
      "pose_mae_dy": 0.016099838539958,
      "pose_rmse_dtheta": 0.18745911121368408,
      "pose_rmse_dx": 0.037009552121162415,
      "pose_rmse_dy": 0.04276690632104874,
      "pose_rmse_mean": 0.08907853066921234,
      "rmse_dtheta": 0.02387448400259018,
      "rmse_dx": 0.004330446943640709,
      "rmse_dy": 0.006438011769205332,
      "rmse_mean": 0.011547647416591644,
      "rotation_flip": 0.004042037297040224,
      "sparse_tokens": 32153.0,
      "step": 11815,
      "turn_loss": 0.08092252165079117,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.5489685931982903,
      "grad_norm": 0.46460047364234924,
      "learning_rate": 5.982238297555509e-09,
      "loss": 0.11,
      "mae_dtheta": 0.0332665741443634,
      "mae_dx": 0.007174259051680565,
      "mae_dy": 0.004455608315765858,
      "pose_mae_dtheta": 0.23209227621555328,
      "pose_mae_dx": 0.05619129538536072,
      "pose_mae_dy": 0.04840570315718651,
      "pose_rmse_dtheta": 0.42391157150268555,
      "pose_rmse_dx": 0.12916095554828644,
      "pose_rmse_dy": 0.13819660246372223,
      "pose_rmse_mean": 0.23042303323745728,
      "rmse_dtheta": 0.053451381623744965,
      "rmse_dx": 0.01697203330695629,
      "rmse_dy": 0.009960195049643517,
      "rmse_mean": 0.026794537901878357,
      "rotation_flip": 0.01155462209135294,
      "sparse_tokens": 15137.0,
      "step": 11816,
      "turn_loss": 0.26585903763771057,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 18449.0,
      "epoch": 0.5490150529641331,
      "grad_norm": 0.6806779503822327,
      "learning_rate": 5.917752968386814e-09,
      "loss": 0.1924,
      "mae_dtheta": 0.0351908840239048,
      "mae_dx": 0.013052181340754032,
      "mae_dy": 0.003963102586567402,
      "pose_mae_dtheta": 0.27799978852272034,
      "pose_mae_dx": 0.10863375663757324,
      "pose_mae_dy": 0.03878406435251236,
      "pose_rmse_dtheta": 0.47981348633766174,
      "pose_rmse_dx": 0.23785454034805298,
      "pose_rmse_dy": 0.08901932835578918,
      "pose_rmse_mean": 0.26889580488204956,
      "rmse_dtheta": 0.05231413617730141,
      "rmse_dx": 0.025127489119768143,
      "rmse_dy": 0.008337498642504215,
      "rmse_mean": 0.028593041002750397,
      "rotation_flip": 0.011337868869304657,
      "sparse_tokens": 15213.0,
      "step": 11817,
      "turn_loss": 0.2460547387599945,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.5490615127299758,
      "grad_norm": 0.31718695163726807,
      "learning_rate": 5.853616878069846e-09,
      "loss": 0.0847,
      "mae_dtheta": 0.03823329508304596,
      "mae_dx": 0.010072065517306328,
      "mae_dy": 0.003932586871087551,
      "pose_mae_dtheta": 0.29760169982910156,
      "pose_mae_dx": 0.0827849954366684,
      "pose_mae_dy": 0.03684692457318306,
      "pose_rmse_dtheta": 0.5750218629837036,
      "pose_rmse_dx": 0.2054033875465393,
      "pose_rmse_dy": 0.09616217017173767,
      "pose_rmse_mean": 0.29219579696655273,
      "rmse_dtheta": 0.06010632961988449,
      "rmse_dx": 0.022143475711345673,
      "rmse_dy": 0.008640121668577194,
      "rmse_mean": 0.03029664419591427,
      "rotation_flip": 0.009107467718422413,
      "sparse_tokens": 8600.0,
      "step": 11818,
      "turn_loss": 0.23153653740882874,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64425.0,
      "epoch": 0.5491079724958187,
      "grad_norm": 0.37525150179862976,
      "learning_rate": 5.789830031089905e-09,
      "loss": 0.0754,
      "mae_dtheta": 0.006003507412970066,
      "mae_dx": 0.0010009889956563711,
      "mae_dy": 0.001027841353788972,
      "pose_mae_dtheta": 0.040510695427656174,
      "pose_mae_dx": 0.012247908860445023,
      "pose_mae_dy": 0.013492844067513943,
      "pose_rmse_dtheta": 0.16149774193763733,
      "pose_rmse_dx": 0.036158375442028046,
      "pose_rmse_dy": 0.03573143482208252,
      "pose_rmse_mean": 0.0777958557009697,
      "rmse_dtheta": 0.019153431057929993,
      "rmse_dx": 0.0035886410623788834,
      "rmse_dy": 0.002643401036038995,
      "rmse_mean": 0.008461824618279934,
      "rotation_flip": 0.0,
      "sparse_tokens": 32025.0,
      "step": 11819,
      "turn_loss": 0.036523159593343735,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.5491544322616614,
      "grad_norm": 0.6325618624687195,
      "learning_rate": 5.726392431908423e-09,
      "loss": 0.1081,
      "mae_dtheta": 0.04119451716542244,
      "mae_dx": 0.018478358164429665,
      "mae_dy": 0.007369931787252426,
      "pose_mae_dtheta": 0.36618736386299133,
      "pose_mae_dx": 0.09945283830165863,
      "pose_mae_dy": 0.0650000050663948,
      "pose_rmse_dtheta": 0.5347731113433838,
      "pose_rmse_dx": 0.18074233829975128,
      "pose_rmse_dy": 0.12210723012685776,
      "pose_rmse_mean": 0.2792075574398041,
      "rmse_dtheta": 0.056813377887010574,
      "rmse_dx": 0.029189718887209892,
      "rmse_dy": 0.013215027749538422,
      "rmse_mean": 0.033072710037231445,
      "rotation_flip": 0.02545454539358616,
      "sparse_tokens": 4480.0,
      "step": 11820,
      "turn_loss": 0.4477055072784424,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.5492008920275042,
      "grad_norm": 0.51749587059021,
      "learning_rate": 5.6633040849601865e-09,
      "loss": 0.1008,
      "mae_dtheta": 0.036508090794086456,
      "mae_dx": 0.007747064344584942,
      "mae_dy": 0.004413051530718803,
      "pose_mae_dtheta": 0.29598671197891235,
      "pose_mae_dx": 0.06848762929439545,
      "pose_mae_dy": 0.04592147469520569,
      "pose_rmse_dtheta": 0.5385268926620483,
      "pose_rmse_dx": 0.13797271251678467,
      "pose_rmse_dy": 0.0983218178153038,
      "pose_rmse_mean": 0.25827381014823914,
      "rmse_dtheta": 0.055760204792022705,
      "rmse_dx": 0.014896229840815067,
      "rmse_dy": 0.008371885865926743,
      "rmse_mean": 0.02634277567267418,
      "rotation_flip": 0.004608294926583767,
      "sparse_tokens": 8096.0,
      "step": 11821,
      "turn_loss": 0.218526691198349,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 28226.0,
      "epoch": 0.5492473517933469,
      "grad_norm": 0.48234403133392334,
      "learning_rate": 5.600564994657776e-09,
      "loss": 0.1228,
      "mae_dtheta": 0.02790830098092556,
      "mae_dx": 0.011332814581692219,
      "mae_dy": 0.006121573969721794,
      "pose_mae_dtheta": 0.2129194438457489,
      "pose_mae_dx": 0.08599109947681427,
      "pose_mae_dy": 0.0520394891500473,
      "pose_rmse_dtheta": 0.37478065490722656,
      "pose_rmse_dx": 0.1886637657880783,
      "pose_rmse_dy": 0.14111897349357605,
      "pose_rmse_mean": 0.23485445976257324,
      "rmse_dtheta": 0.04532167688012123,
      "rmse_dx": 0.022794323042035103,
      "rmse_dy": 0.014452846720814705,
      "rmse_mean": 0.027522949501872063,
      "rotation_flip": 0.010130246169865131,
      "sparse_tokens": 23853.0,
      "step": 11822,
      "turn_loss": 0.28832200169563293,
      "turns": 87.0,
      "turns_per_sample": 87.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5492938115591898,
      "grad_norm": 0.37223491072654724,
      "learning_rate": 5.538175165388793e-09,
      "loss": 0.0779,
      "mae_dtheta": 0.006713423877954483,
      "mae_dx": 0.0015490263467654586,
      "mae_dy": 0.001015783054754138,
      "pose_mae_dtheta": 0.04437996819615364,
      "pose_mae_dx": 0.01251442264765501,
      "pose_mae_dy": 0.010686102323234081,
      "pose_rmse_dtheta": 0.16983170807361603,
      "pose_rmse_dx": 0.04768985137343407,
      "pose_rmse_dy": 0.03281207010149956,
      "pose_rmse_mean": 0.08344455063343048,
      "rmse_dtheta": 0.023546399548649788,
      "rmse_dx": 0.006114615127444267,
      "rmse_dy": 0.003935655578970909,
      "rmse_mean": 0.011198891326785088,
      "rotation_flip": 0.0027979854494333267,
      "sparse_tokens": 32153.0,
      "step": 11823,
      "turn_loss": 0.05126754194498062,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5493402713250325,
      "grad_norm": 0.41322559118270874,
      "learning_rate": 5.476134601515859e-09,
      "loss": 0.1037,
      "mae_dtheta": 0.012741724029183388,
      "mae_dx": 0.0022539219353348017,
      "mae_dy": 0.0030002216808497906,
      "pose_mae_dtheta": 0.09446590393781662,
      "pose_mae_dx": 0.023988617584109306,
      "pose_mae_dy": 0.0320148803293705,
      "pose_rmse_dtheta": 0.23261432349681854,
      "pose_rmse_dx": 0.06793312728404999,
      "pose_rmse_dy": 0.07352985441684723,
      "pose_rmse_mean": 0.12469244003295898,
      "rmse_dtheta": 0.027168260887265205,
      "rmse_dx": 0.008227348327636719,
      "rmse_dy": 0.007265482563525438,
      "rmse_mean": 0.014220363460481167,
      "rotation_flip": 0.00686168298125267,
      "sparse_tokens": 32105.0,
      "step": 11824,
      "turn_loss": 0.11315662413835526,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5493867310908753,
      "grad_norm": 0.35868120193481445,
      "learning_rate": 5.414443307377171e-09,
      "loss": 0.092,
      "mae_dtheta": 0.009811222553253174,
      "mae_dx": 0.002362445229664445,
      "mae_dy": 0.003254770068451762,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.35868120193481445,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 154.98382568359375,
      "model/head/act_norm_mean": 100.13417376893939,
      "model/head/act_norm_min": 44.431392669677734,
      "model/head/act_over_embed": 68.81314168492007,
      "model/head/grad_frac": 0.10815494507551193,
      "model/head/grad_norm": 0.03879314661026001,
      "model/head/grad_zero_frac": 0.00018021036521531641,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.707815459280303,
      "model/head/update_ratio": 0.0006603653309866786,
      "model/head/weight_delta": 9.986119270324707,
      "model/head/weight_delta_rel": 0.17518611252307892,
      "model/head/weight_norm": 58.74497604370117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42293232679367065,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228668885083976,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227902889251709,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905980847251552,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10419300943613052,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03737207502126694,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5329019823788547,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012067239731550217,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569344997406006,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314688831567764,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96986198425293,
      "model/modality_embedder/grad_frac": 0.10419300943613052,
      "model/modality_embedder/grad_norm": 0.03737207502126694,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5329019823788547,
      "model/modality_embedder/update_ratio": 0.0012067239731550217,
      "model/modality_embedder/weight_delta": 3.1569344997406006,
      "model/modality_embedder/weight_delta_rel": 0.10314688831567764,
      "model/modality_embedder/weight_norm": 30.96986198425293,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 86.45632934570312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.73578292849126,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 11.993707656860352,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.624242884212569,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.05834577605128288,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.020927533507347107,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0007484470261260867,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7429299354553223,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0999540239572525,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961275100708008,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 88.272216796875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.702689093314092,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.532750129699707,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.288709852996956,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0643329918384552,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.023075034841895103,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007750848308205605,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4776968955993652,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12047013640403748,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770980834960938,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.14573669433594,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.55521985730319,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.020277976989746,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.56178633767653,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.062461093068122864,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.022403620183467865,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00021687378466594964,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.000728749088011682,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.76770281791687,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12651240825653076,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742570877075195,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 91.00244140625,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.36838874859708,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.397137641906738,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.8078129749283,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05573076754808426,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.019989578053355217,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006673023453913629,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.238766670227051,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11068567633628845,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95580291748047,
      "model/normalizer/grad_frac": 0.21334068477153778,
      "model/normalizer/grad_norm": 0.07652129232883453,
      "model/normalizer/grad_zero_frac": 0.00023162072466220707,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0009728334262035787,
      "model/normalizer/weight_delta": 6.810927867889404,
      "model/normalizer/weight_delta_rel": 0.08772080391645432,
      "model/normalizer/weight_norm": 78.65816497802734,
      "pose_mae_dtheta": 0.06201319769024849,
      "pose_mae_dx": 0.028904646635055542,
      "pose_mae_dy": 0.023667624220252037,
      "pose_rmse_dtheta": 0.16064663231372833,
      "pose_rmse_dx": 0.10054527968168259,
      "pose_rmse_dy": 0.05073792114853859,
      "pose_rmse_mean": 0.10397660732269287,
      "rmse_dtheta": 0.02179891988635063,
      "rmse_dx": 0.007440968882292509,
      "rmse_dy": 0.008290313184261322,
      "rmse_mean": 0.012510067783296108,
      "rotation_flip": 0.006058446131646633,
      "sparse_tokens": 32137.0,
      "step": 11825,
      "turn_loss": 0.10034127533435822,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.549433190856718,
      "grad_norm": 0.28477492928504944,
      "learning_rate": 5.35310128728761e-09,
      "loss": 0.0715,
      "mae_dtheta": 0.007899131625890732,
      "mae_dx": 0.0015416700625792146,
      "mae_dy": 0.001621962757781148,
      "pose_mae_dtheta": 0.06065312400460243,
      "pose_mae_dx": 0.0150467399507761,
      "pose_mae_dy": 0.019872073084115982,
      "pose_rmse_dtheta": 0.204533189535141,
      "pose_rmse_dx": 0.05944431200623512,
      "pose_rmse_dy": 0.06732726097106934,
      "pose_rmse_mean": 0.11043491959571838,
      "rmse_dtheta": 0.023272663354873657,
      "rmse_dx": 0.005820091348141432,
      "rmse_dy": 0.005493295378983021,
      "rmse_mean": 0.011528683826327324,
      "rotation_flip": 0.004466098267585039,
      "sparse_tokens": 32137.0,
      "step": 11826,
      "turn_loss": 0.06157393380999565,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.5494796506225609,
      "grad_norm": 0.743251621723175,
      "learning_rate": 5.292108545536523e-09,
      "loss": 0.1764,
      "mae_dtheta": 0.0121346116065979,
      "mae_dx": 0.005584673024713993,
      "mae_dy": 0.0021158652380108833,
      "pose_mae_dtheta": 0.0855010375380516,
      "pose_mae_dx": 0.0488479845225811,
      "pose_mae_dy": 0.028544962406158447,
      "pose_rmse_dtheta": 0.15791083872318268,
      "pose_rmse_dx": 0.15683071315288544,
      "pose_rmse_dy": 0.07019433379173279,
      "pose_rmse_mean": 0.12831196188926697,
      "rmse_dtheta": 0.023204173892736435,
      "rmse_dx": 0.015629632398486137,
      "rmse_dy": 0.004222534596920013,
      "rmse_mean": 0.014352113008499146,
      "rotation_flip": 0.009950248524546623,
      "sparse_tokens": 8716.0,
      "step": 11827,
      "turn_loss": 0.11377604305744171,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5495261103884036,
      "grad_norm": 0.4401687681674957,
      "learning_rate": 5.2314650863888315e-09,
      "loss": 0.1156,
      "mae_dtheta": 0.008067043498158455,
      "mae_dx": 0.0012585632503032684,
      "mae_dy": 0.002018341328948736,
      "pose_mae_dtheta": 0.05207711458206177,
      "pose_mae_dx": 0.01567951589822769,
      "pose_mae_dy": 0.020673125982284546,
      "pose_rmse_dtheta": 0.1247207298874855,
      "pose_rmse_dx": 0.03776615113019943,
      "pose_rmse_dy": 0.04495708644390106,
      "pose_rmse_mean": 0.069147989153862,
      "rmse_dtheta": 0.018837925046682358,
      "rmse_dx": 0.0032221979927271605,
      "rmse_dy": 0.0041326796635985374,
      "rmse_mean": 0.00873093493282795,
      "rotation_flip": 0.003914590924978256,
      "sparse_tokens": 32137.0,
      "step": 11828,
      "turn_loss": 0.06754934787750244,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24987.0,
      "epoch": 0.5495725701542464,
      "grad_norm": 0.4249679446220398,
      "learning_rate": 5.171170914086143e-09,
      "loss": 0.0852,
      "mae_dtheta": 0.027581123635172844,
      "mae_dx": 0.010709461756050587,
      "mae_dy": 0.003112826496362686,
      "pose_mae_dtheta": 0.21798467636108398,
      "pose_mae_dx": 0.08513182401657104,
      "pose_mae_dy": 0.04106352850794792,
      "pose_rmse_dtheta": 0.3958548903465271,
      "pose_rmse_dx": 0.20579756796360016,
      "pose_rmse_dy": 0.11750371009111404,
      "pose_rmse_mean": 0.2397187203168869,
      "rmse_dtheta": 0.04565354809165001,
      "rmse_dx": 0.02311798371374607,
      "rmse_dy": 0.008445609360933304,
      "rmse_mean": 0.025739049538969994,
      "rotation_flip": 0.012572533451020718,
      "sparse_tokens": 20003.0,
      "step": 11829,
      "turn_loss": 0.2157331258058548,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5496190299200892,
      "grad_norm": 0.7090833187103271,
      "learning_rate": 5.111226032843974e-09,
      "loss": 0.1425,
      "mae_dtheta": 0.003967731725424528,
      "mae_dx": 0.0017256744904443622,
      "mae_dy": 0.0003344088909216225,
      "pose_mae_dtheta": 0.030652405694127083,
      "pose_mae_dx": 0.015447638928890228,
      "pose_mae_dy": 0.006006506737321615,
      "pose_rmse_dtheta": 0.13543559610843658,
      "pose_rmse_dx": 0.06265443563461304,
      "pose_rmse_dy": 0.027647839859128,
      "pose_rmse_mean": 0.07524596154689789,
      "rmse_dtheta": 0.01666230335831642,
      "rmse_dx": 0.00680782925337553,
      "rmse_dy": 0.001029200037010014,
      "rmse_mean": 0.008166445419192314,
      "rotation_flip": 0.0021691974252462387,
      "sparse_tokens": 32089.0,
      "step": 11830,
      "turn_loss": 0.03761462867259979,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13970.0,
      "epoch": 0.549665489685932,
      "grad_norm": 0.6007935404777527,
      "learning_rate": 5.0516304468545274e-09,
      "loss": 0.1526,
      "mae_dtheta": 0.034072790294885635,
      "mae_dx": 0.011362040415406227,
      "mae_dy": 0.00512048089876771,
      "pose_mae_dtheta": 0.26853886246681213,
      "pose_mae_dx": 0.09663217514753342,
      "pose_mae_dy": 0.07235583662986755,
      "pose_rmse_dtheta": 0.5081169605255127,
      "pose_rmse_dx": 0.2062375545501709,
      "pose_rmse_dy": 0.14318214356899261,
      "pose_rmse_mean": 0.2858455777168274,
      "rmse_dtheta": 0.05241362378001213,
      "rmse_dx": 0.024080174043774605,
      "rmse_dy": 0.008285739459097385,
      "rmse_mean": 0.028259847313165665,
      "rotation_flip": 0.010574018582701683,
      "sparse_tokens": 11120.0,
      "step": 11831,
      "turn_loss": 0.28881165385246277,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 16886.0,
      "epoch": 0.5497119494517748,
      "grad_norm": 1.0505834817886353,
      "learning_rate": 4.992384160286134e-09,
      "loss": 0.2414,
      "mae_dtheta": 0.02200939878821373,
      "mae_dx": 0.010806983336806297,
      "mae_dy": 0.003758921753615141,
      "pose_mae_dtheta": 0.16137973964214325,
      "pose_mae_dx": 0.07561834156513214,
      "pose_mae_dy": 0.05741729587316513,
      "pose_rmse_dtheta": 0.30215469002723694,
      "pose_rmse_dx": 0.19402623176574707,
      "pose_rmse_dy": 0.1314597874879837,
      "pose_rmse_mean": 0.20921358466148376,
      "rmse_dtheta": 0.0361415334045887,
      "rmse_dx": 0.024995479732751846,
      "rmse_dy": 0.006948395632207394,
      "rmse_mean": 0.022695137187838554,
      "rotation_flip": 0.00935828872025013,
      "sparse_tokens": 13199.0,
      "step": 11832,
      "turn_loss": 0.16790668666362762,
      "turns": 52.0,
      "turns_per_sample": 52.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.5497584092176175,
      "grad_norm": 0.7713631391525269,
      "learning_rate": 4.933487177280483e-09,
      "loss": 0.1442,
      "mae_dtheta": 0.02844933047890663,
      "mae_dx": 0.005458084866404533,
      "mae_dy": 0.0038807885721325874,
      "pose_mae_dtheta": 0.24888454377651215,
      "pose_mae_dx": 0.05535847321152687,
      "pose_mae_dy": 0.0650831088423729,
      "pose_rmse_dtheta": 0.46086445450782776,
      "pose_rmse_dx": 0.14775635302066803,
      "pose_rmse_dy": 0.13261272013187408,
      "pose_rmse_mean": 0.2470778524875641,
      "rmse_dtheta": 0.046300023794174194,
      "rmse_dx": 0.01500790286809206,
      "rmse_dy": 0.006994511000812054,
      "rmse_mean": 0.022767480462789536,
      "rotation_flip": 0.008547008968889713,
      "sparse_tokens": 11905.0,
      "step": 11833,
      "turn_loss": 0.20715636014938354,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 25879.0,
      "epoch": 0.5498048689834604,
      "grad_norm": 0.6501635313034058,
      "learning_rate": 4.874939501957609e-09,
      "loss": 0.1705,
      "mae_dtheta": 0.03240032494068146,
      "mae_dx": 0.012037521228194237,
      "mae_dy": 0.004686914384365082,
      "pose_mae_dtheta": 0.2603897750377655,
      "pose_mae_dx": 0.09671732783317566,
      "pose_mae_dy": 0.05878911539912224,
      "pose_rmse_dtheta": 0.42024433612823486,
      "pose_rmse_dx": 0.23507076501846313,
      "pose_rmse_dy": 0.1394086629152298,
      "pose_rmse_mean": 0.26490792632102966,
      "rmse_dtheta": 0.04858498275279999,
      "rmse_dx": 0.025386249646544456,
      "rmse_dy": 0.008959917351603508,
      "rmse_mean": 0.02764371782541275,
      "rotation_flip": 0.011814345605671406,
      "sparse_tokens": 19493.0,
      "step": 11834,
      "turn_loss": 0.27775394916534424,
      "turns": 80.0,
      "turns_per_sample": 80.0
    },
    {
      "dense_tokens": 18507.0,
      "epoch": 0.5498513287493031,
      "grad_norm": 0.8047213554382324,
      "learning_rate": 4.816741138411462e-09,
      "loss": 0.255,
      "mae_dtheta": 0.026447923853993416,
      "mae_dx": 0.011231997981667519,
      "mae_dy": 0.003422454698011279,
      "pose_mae_dtheta": 0.19032153487205505,
      "pose_mae_dx": 0.10384475439786911,
      "pose_mae_dy": 0.03748733550310135,
      "pose_rmse_dtheta": 0.3441231846809387,
      "pose_rmse_dx": 0.250389039516449,
      "pose_rmse_dy": 0.10249853879213333,
      "pose_rmse_mean": 0.23233692348003387,
      "rmse_dtheta": 0.04361219331622124,
      "rmse_dx": 0.024399010464549065,
      "rmse_dy": 0.009033122099936008,
      "rmse_mean": 0.02568144164979458,
      "rotation_flip": 0.014409221708774567,
      "sparse_tokens": 13656.0,
      "step": 11835,
      "turn_loss": 0.2585952579975128,
      "turns": 57.0,
      "turns_per_sample": 57.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5498977885151459,
      "grad_norm": 0.638519287109375,
      "learning_rate": 4.758892090711009e-09,
      "loss": 0.1375,
      "mae_dtheta": 0.013309739530086517,
      "mae_dx": 0.0022164646070450544,
      "mae_dy": 0.003573204856365919,
      "pose_mae_dtheta": 0.09166455268859863,
      "pose_mae_dx": 0.03131769597530365,
      "pose_mae_dy": 0.03815123066306114,
      "pose_rmse_dtheta": 0.22475382685661316,
      "pose_rmse_dx": 0.08475106209516525,
      "pose_rmse_dy": 0.09676649421453476,
      "pose_rmse_mean": 0.13542380928993225,
      "rmse_dtheta": 0.027539515867829323,
      "rmse_dx": 0.0055580222979187965,
      "rmse_dy": 0.007840834558010101,
      "rmse_mean": 0.013646124862134457,
      "rotation_flip": 0.005285412073135376,
      "sparse_tokens": 32105.0,
      "step": 11836,
      "turn_loss": 0.12063459306955338,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64617.0,
      "epoch": 0.5499442482809886,
      "grad_norm": 0.4141870439052582,
      "learning_rate": 4.701392362903012e-09,
      "loss": 0.0792,
      "mae_dtheta": 0.007450462318956852,
      "mae_dx": 0.001780262216925621,
      "mae_dy": 0.002078435616567731,
      "pose_mae_dtheta": 0.04748217761516571,
      "pose_mae_dx": 0.016686737537384033,
      "pose_mae_dy": 0.015010173432528973,
      "pose_rmse_dtheta": 0.12493833154439926,
      "pose_rmse_dx": 0.03901538625359535,
      "pose_rmse_dy": 0.036867253482341766,
      "pose_rmse_mean": 0.06694032996892929,
      "rmse_dtheta": 0.019141223281621933,
      "rmse_dx": 0.004580340813845396,
      "rmse_dy": 0.004788751248270273,
      "rmse_mean": 0.00950343906879425,
      "rotation_flip": 0.0036049026530236006,
      "sparse_tokens": 32217.0,
      "step": 11837,
      "turn_loss": 0.06504032015800476,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5499907080468315,
      "grad_norm": 0.40818819403648376,
      "learning_rate": 4.644241959007589e-09,
      "loss": 0.0691,
      "mae_dtheta": 0.01332817692309618,
      "mae_dx": 0.00163231638725847,
      "mae_dy": 0.0032856680918484926,
      "pose_mae_dtheta": 0.09020532667636871,
      "pose_mae_dx": 0.02736181579530239,
      "pose_mae_dy": 0.038417987525463104,
      "pose_rmse_dtheta": 0.18600891530513763,
      "pose_rmse_dx": 0.061064768582582474,
      "pose_rmse_dy": 0.07696525752544403,
      "pose_rmse_mean": 0.10801297426223755,
      "rmse_dtheta": 0.024292947724461555,
      "rmse_dx": 0.004363357555121183,
      "rmse_dy": 0.00626043975353241,
      "rmse_mean": 0.011638915166258812,
      "rotation_flip": 0.005540166050195694,
      "sparse_tokens": 32073.0,
      "step": 11838,
      "turn_loss": 0.11253435164690018,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13605.0,
      "epoch": 0.5500371678126742,
      "grad_norm": 0.4417753517627716,
      "learning_rate": 4.587440883021543e-09,
      "loss": 0.0992,
      "mae_dtheta": 0.026843370869755745,
      "mae_dx": 0.004436687100678682,
      "mae_dy": 0.0022803733590990305,
      "pose_mae_dtheta": 0.22545334696769714,
      "pose_mae_dx": 0.04407098889350891,
      "pose_mae_dy": 0.03896232321858406,
      "pose_rmse_dtheta": 0.46449798345565796,
      "pose_rmse_dx": 0.12369836866855621,
      "pose_rmse_dy": 0.10770384967327118,
      "pose_rmse_mean": 0.23196673393249512,
      "rmse_dtheta": 0.047901131212711334,
      "rmse_dx": 0.013055610470473766,
      "rmse_dy": 0.00512811541557312,
      "rmse_mean": 0.02202828787267208,
      "rotation_flip": 0.022727273404598236,
      "sparse_tokens": 11123.0,
      "step": 11839,
      "turn_loss": 0.1517813503742218,
      "turns": 42.0,
      "turns_per_sample": 42.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.550083627578517,
      "grad_norm": 0.5145435929298401,
      "learning_rate": 4.530989138916697e-09,
      "loss": 0.1441,
      "mae_dtheta": 0.027372537180781364,
      "mae_dx": 0.008329013362526894,
      "mae_dy": 0.004370798822492361,
      "pose_mae_dtheta": 0.21713221073150635,
      "pose_mae_dx": 0.07027602940797806,
      "pose_mae_dy": 0.04643553867936134,
      "pose_rmse_dtheta": 0.3906203508377075,
      "pose_rmse_dx": 0.16169029474258423,
      "pose_rmse_dy": 0.09845972061157227,
      "pose_rmse_mean": 0.21692346036434174,
      "rmse_dtheta": 0.04268364608287811,
      "rmse_dx": 0.018155604600906372,
      "rmse_dy": 0.008571411482989788,
      "rmse_mean": 0.023136887699365616,
      "rotation_flip": 0.013546798378229141,
      "sparse_tokens": 13141.0,
      "step": 11840,
      "turn_loss": 0.23491184413433075,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5501300873443598,
      "grad_norm": 0.30536800622940063,
      "learning_rate": 4.474886730641004e-09,
      "loss": 0.0854,
      "mae_dtheta": 0.0077113923616707325,
      "mae_dx": 0.0015482112066820264,
      "mae_dy": 0.002393702743574977,
      "pose_mae_dtheta": 0.05100603029131889,
      "pose_mae_dx": 0.02315649576485157,
      "pose_mae_dy": 0.022126290947198868,
      "pose_rmse_dtheta": 0.15679560601711273,
      "pose_rmse_dx": 0.0702688992023468,
      "pose_rmse_dy": 0.06175432726740837,
      "pose_rmse_mean": 0.09627294540405273,
      "rmse_dtheta": 0.01982867904007435,
      "rmse_dx": 0.004071392584592104,
      "rmse_dy": 0.006055339705199003,
      "rmse_mean": 0.009985137730836868,
      "rotation_flip": 0.004930156283080578,
      "sparse_tokens": 32089.0,
      "step": 11841,
      "turn_loss": 0.0763661339879036,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5501765471102026,
      "grad_norm": 0.4264686405658722,
      "learning_rate": 4.419133662117992e-09,
      "loss": 0.1014,
      "mae_dtheta": 0.006872598081827164,
      "mae_dx": 0.0007612343179062009,
      "mae_dy": 0.0004713045200332999,
      "pose_mae_dtheta": 0.05422179028391838,
      "pose_mae_dx": 0.007198741193860769,
      "pose_mae_dy": 0.006659361999481916,
      "pose_rmse_dtheta": 0.26113009452819824,
      "pose_rmse_dx": 0.02150140330195427,
      "pose_rmse_dy": 0.018907511606812477,
      "pose_rmse_mean": 0.10051300376653671,
      "rmse_dtheta": 0.026584934443235397,
      "rmse_dx": 0.0027430576737970114,
      "rmse_dy": 0.001403050497174263,
      "rmse_mean": 0.010243681259453297,
      "rotation_flip": 0.0007127583958208561,
      "sparse_tokens": 32089.0,
      "step": 11842,
      "turn_loss": 0.03200918436050415,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5502230068760453,
      "grad_norm": 0.494752436876297,
      "learning_rate": 4.3637299372462085e-09,
      "loss": 0.1419,
      "mae_dtheta": 0.006894979160279036,
      "mae_dx": 0.001008775201626122,
      "mae_dy": 0.0017886984860524535,
      "pose_mae_dtheta": 0.041877977550029755,
      "pose_mae_dx": 0.015229955315589905,
      "pose_mae_dy": 0.02294948510825634,
      "pose_rmse_dtheta": 0.07639916986227036,
      "pose_rmse_dx": 0.03613667190074921,
      "pose_rmse_dy": 0.04968532919883728,
      "pose_rmse_mean": 0.054073721170425415,
      "rmse_dtheta": 0.013382895849645138,
      "rmse_dx": 0.0028149159625172615,
      "rmse_dy": 0.0036508524790406227,
      "rmse_mean": 0.006616221275180578,
      "rotation_flip": 0.004960727412253618,
      "sparse_tokens": 32073.0,
      "step": 11843,
      "turn_loss": 0.06262548267841339,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14573.0,
      "epoch": 0.5502694666418881,
      "grad_norm": 0.5010188221931458,
      "learning_rate": 4.308675559900333e-09,
      "loss": 0.1474,
      "mae_dtheta": 0.03459452465176582,
      "mae_dx": 0.009581107646226883,
      "mae_dy": 0.00735271442681551,
      "pose_mae_dtheta": 0.25936049222946167,
      "pose_mae_dx": 0.07358956336975098,
      "pose_mae_dy": 0.07967725396156311,
      "pose_rmse_dtheta": 0.43323588371276855,
      "pose_rmse_dx": 0.18598686158657074,
      "pose_rmse_dy": 0.15520460903644562,
      "pose_rmse_mean": 0.25814247131347656,
      "rmse_dtheta": 0.04985157027840614,
      "rmse_dx": 0.020421527326107025,
      "rmse_dy": 0.012290884740650654,
      "rmse_mean": 0.02752133086323738,
      "rotation_flip": 0.019607843831181526,
      "sparse_tokens": 10729.0,
      "step": 11844,
      "turn_loss": 0.2967032194137573,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5503159264077309,
      "grad_norm": 0.8261423110961914,
      "learning_rate": 4.253970533929508e-09,
      "loss": 0.1259,
      "mae_dtheta": 0.008415225893259048,
      "mae_dx": 0.0013747111661359668,
      "mae_dy": 0.0016140539664775133,
      "pose_mae_dtheta": 0.05277468264102936,
      "pose_mae_dx": 0.014560109004378319,
      "pose_mae_dy": 0.018691981211304665,
      "pose_rmse_dtheta": 0.15697266161441803,
      "pose_rmse_dx": 0.03543934226036072,
      "pose_rmse_dy": 0.05292154476046562,
      "pose_rmse_mean": 0.08177785575389862,
      "rmse_dtheta": 0.021697955206036568,
      "rmse_dx": 0.004020776133984327,
      "rmse_dy": 0.0037086880765855312,
      "rmse_mean": 0.009809140115976334,
      "rotation_flip": 0.008004268631339073,
      "sparse_tokens": 32073.0,
      "step": 11845,
      "turn_loss": 0.0763067752122879,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5503623861735737,
      "grad_norm": 0.8210976123809814,
      "learning_rate": 4.199614863160673e-09,
      "loss": 0.1791,
      "mae_dtheta": 0.01078727189451456,
      "mae_dx": 0.0015793915372341871,
      "mae_dy": 0.00262200809083879,
      "pose_mae_dtheta": 0.07245476543903351,
      "pose_mae_dx": 0.02068069390952587,
      "pose_mae_dy": 0.02493366040289402,
      "pose_rmse_dtheta": 0.20565669238567352,
      "pose_rmse_dx": 0.06314535439014435,
      "pose_rmse_dy": 0.06285814195871353,
      "pose_rmse_mean": 0.11055339872837067,
      "rmse_dtheta": 0.02470034919679165,
      "rmse_dx": 0.0043414621613919735,
      "rmse_dy": 0.007266510743647814,
      "rmse_mean": 0.01210277434438467,
      "rotation_flip": 0.005850234068930149,
      "sparse_tokens": 32105.0,
      "step": 11846,
      "turn_loss": 0.0909917801618576,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.5504088459394164,
      "grad_norm": 0.57552570104599,
      "learning_rate": 4.145608551393565e-09,
      "loss": 0.1603,
      "mae_dtheta": 0.02660263702273369,
      "mae_dx": 0.006942736450582743,
      "mae_dy": 0.005004222504794598,
      "pose_mae_dtheta": 0.1913500428199768,
      "pose_mae_dx": 0.06261973083019257,
      "pose_mae_dy": 0.06257067620754242,
      "pose_rmse_dtheta": 0.3613496422767639,
      "pose_rmse_dx": 0.13603611290454865,
      "pose_rmse_dy": 0.16002687811851501,
      "pose_rmse_mean": 0.2191375494003296,
      "rmse_dtheta": 0.04386600852012634,
      "rmse_dx": 0.016960429027676582,
      "rmse_dy": 0.0098245395347476,
      "rmse_mean": 0.023550324141979218,
      "rotation_flip": 0.011137628927826881,
      "sparse_tokens": 22389.0,
      "step": 11847,
      "turn_loss": 0.221330463886261,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.5504553057052592,
      "grad_norm": 0.43228480219841003,
      "learning_rate": 4.091951602405719e-09,
      "loss": 0.0724,
      "mae_dtheta": 0.007670402526855469,
      "mae_dx": 0.0011294790310785174,
      "mae_dy": 0.0006236883345991373,
      "pose_mae_dtheta": 0.0541824996471405,
      "pose_mae_dx": 0.009427905082702637,
      "pose_mae_dy": 0.009239251725375652,
      "pose_rmse_dtheta": 0.20956958830356598,
      "pose_rmse_dx": 0.02117796428501606,
      "pose_rmse_dy": 0.02820638194680214,
      "pose_rmse_mean": 0.08631797879934311,
      "rmse_dtheta": 0.025175398215651512,
      "rmse_dx": 0.003118747379630804,
      "rmse_dy": 0.0016647872980684042,
      "rmse_mean": 0.009986311197280884,
      "rotation_flip": 0.0013888889225199819,
      "sparse_tokens": 32201.0,
      "step": 11848,
      "turn_loss": 0.04634492099285126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5505017654711021,
      "grad_norm": 0.3842053711414337,
      "learning_rate": 4.0386440199491335e-09,
      "loss": 0.0843,
      "mae_dtheta": 0.005251257214695215,
      "mae_dx": 0.0009549771202728152,
      "mae_dy": 0.0009099444723688066,
      "pose_mae_dtheta": 0.032155659049749374,
      "pose_mae_dx": 0.011449315585196018,
      "pose_mae_dy": 0.011646094731986523,
      "pose_rmse_dtheta": 0.09403454512357712,
      "pose_rmse_dx": 0.027944114059209824,
      "pose_rmse_dy": 0.0322144590318203,
      "pose_rmse_mean": 0.05139770731329918,
      "rmse_dtheta": 0.015228568576276302,
      "rmse_dx": 0.0029684712644666433,
      "rmse_dy": 0.002134600654244423,
      "rmse_mean": 0.006777213420718908,
      "rotation_flip": 0.00712589081376791,
      "sparse_tokens": 32137.0,
      "step": 11849,
      "turn_loss": 0.04336196184158325,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.5505482252369448,
      "grad_norm": 0.7348190546035767,
      "learning_rate": 3.985685807751938e-09,
      "loss": 0.2237,
      "mae_dtheta": 0.040728140622377396,
      "mae_dx": 0.015019561164081097,
      "mae_dy": 0.007792710792273283,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.7348190546035767,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 131.13958740234375,
      "model/head/act_norm_mean": 100.88909357244319,
      "model/head/act_norm_min": 79.10089874267578,
      "model/head/act_over_embed": 69.33192964155843,
      "model/head/grad_frac": 0.12418179214000702,
      "model/head/grad_norm": 0.09125114977359772,
      "model/head/grad_zero_frac": 0.00016974039317574352,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7038352272727273,
      "model/head/update_ratio": 0.0015533438418060541,
      "model/head/weight_delta": 9.986125946044922,
      "model/head/weight_delta_rel": 0.17518623173236847,
      "model/head/weight_norm": 58.74497604370117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42286911606788635,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42286911606788635,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42286911606788635,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905996155248906,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10195949673652649,
      "model/modality_embedder.encoders.pose/grad_norm": 0.07492177933454514,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0024191834963858128,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156935453414917,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314691811800003,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96986198425293,
      "model/modality_embedder/grad_frac": 0.10195949673652649,
      "model/modality_embedder/grad_norm": 0.07492177933454514,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.0024191834963858128,
      "model/modality_embedder/weight_delta": 3.156935453414917,
      "model/modality_embedder/weight_delta_rel": 0.10314691811800003,
      "model/modality_embedder/weight_norm": 30.96986198425293,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 70.09062194824219,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.863708231872295,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.452370643615723,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.712154350351573,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.10165226459503174,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.07469601929187775,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.002671409398317337,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7429351806640625,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995421022176743,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96127700805664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 71.91583251953125,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.638576050685426,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.812252044677734,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.244650769866773,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08909682184457779,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.06547003984451294,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0021991224493831396,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.477703094482422,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12047035247087479,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77098274230957,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 73.80528259277344,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.17099567099567,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.237241744995117,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.297743879682493,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.09497779607772827,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.06979149580001831,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.000181568757398054,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0022701905108988285,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7677102088928223,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12651266157627106,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742570877075195,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 74.5735855102539,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.031965863997115,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.143674850463867,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.576620018990532,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.08418522775173187,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.061860907822847366,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0020650725346058607,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2387735843658447,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11068591475486755,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.95580291748047,
      "model/normalizer/grad_frac": 0.3880593180656433,
      "model/normalizer/grad_norm": 0.2851533889770508,
      "model/normalizer/grad_zero_frac": 0.00016189816233236343,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003625222947448492,
      "model/normalizer/weight_delta": 6.810941219329834,
      "model/normalizer/weight_delta_rel": 0.08772098273038864,
      "model/normalizer/weight_norm": 78.65816497802734,
      "pose_mae_dtheta": 0.3680987060070038,
      "pose_mae_dx": 0.08890155702829361,
      "pose_mae_dy": 0.07450369745492935,
      "pose_rmse_dtheta": 0.5816283226013184,
      "pose_rmse_dx": 0.1959654837846756,
      "pose_rmse_dy": 0.15742211043834686,
      "pose_rmse_mean": 0.3116719722747803,
      "rmse_dtheta": 0.06048866733908653,
      "rmse_dx": 0.02711341716349125,
      "rmse_dy": 0.01479429006576538,
      "rmse_mean": 0.03413212671875954,
      "rotation_flip": 0.008498583920300007,
      "sparse_tokens": 6160.0,
      "step": 11850,
      "turn_loss": 0.3435225188732147,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5505946850027876,
      "grad_norm": 0.3963165283203125,
      "learning_rate": 3.9330769695167245e-09,
      "loss": 0.0969,
      "mae_dtheta": 0.00716830650344491,
      "mae_dx": 0.0010551090817898512,
      "mae_dy": 0.0011966004967689514,
      "pose_mae_dtheta": 0.048934608697891235,
      "pose_mae_dx": 0.013221168890595436,
      "pose_mae_dy": 0.017521832138299942,
      "pose_rmse_dtheta": 0.14406786859035492,
      "pose_rmse_dx": 0.03411846607923508,
      "pose_rmse_dy": 0.04224782437086105,
      "pose_rmse_mean": 0.07347805798053741,
      "rmse_dtheta": 0.018497129902243614,
      "rmse_dx": 0.003953807521611452,
      "rmse_dy": 0.0025430854875594378,
      "rmse_mean": 0.008331341668963432,
      "rotation_flip": 0.0032183907460421324,
      "sparse_tokens": 32073.0,
      "step": 11851,
      "turn_loss": 0.05027562007308006,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 30819.0,
      "epoch": 0.5506411447686304,
      "grad_norm": 0.633660614490509,
      "learning_rate": 3.880817508923329e-09,
      "loss": 0.1497,
      "mae_dtheta": 0.028908969834446907,
      "mae_dx": 0.008980787359178066,
      "mae_dy": 0.004750474821776152,
      "pose_mae_dtheta": 0.22318601608276367,
      "pose_mae_dx": 0.06471504271030426,
      "pose_mae_dy": 0.04227422550320625,
      "pose_rmse_dtheta": 0.4083077609539032,
      "pose_rmse_dx": 0.13803160190582275,
      "pose_rmse_dy": 0.10138392448425293,
      "pose_rmse_mean": 0.21590778231620789,
      "rmse_dtheta": 0.0472198911011219,
      "rmse_dx": 0.01916818879544735,
      "rmse_dy": 0.010896435007452965,
      "rmse_mean": 0.025761505588889122,
      "rotation_flip": 0.01541695836931467,
      "sparse_tokens": 24742.0,
      "step": 11852,
      "turn_loss": 0.24003832042217255,
      "turns": 95.0,
      "turns_per_sample": 95.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5506876045344732,
      "grad_norm": 0.4251052439212799,
      "learning_rate": 3.8289074296260495e-09,
      "loss": 0.0867,
      "mae_dtheta": 0.00794947613030672,
      "mae_dx": 0.0014902392867952585,
      "mae_dy": 0.001332795829512179,
      "pose_mae_dtheta": 0.04956571385264397,
      "pose_mae_dx": 0.01697566546499729,
      "pose_mae_dy": 0.01552117895334959,
      "pose_rmse_dtheta": 0.15819574892520905,
      "pose_rmse_dx": 0.04880915954709053,
      "pose_rmse_dy": 0.049372363835573196,
      "pose_rmse_mean": 0.08545909821987152,
      "rmse_dtheta": 0.023455172777175903,
      "rmse_dx": 0.004173981491476297,
      "rmse_dy": 0.003980119246989489,
      "rmse_mean": 0.010536424815654755,
      "rotation_flip": 0.004512126557528973,
      "sparse_tokens": 32121.0,
      "step": 11853,
      "turn_loss": 0.06514771282672882,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5507340643003159,
      "grad_norm": 0.5376909971237183,
      "learning_rate": 3.777346735254761e-09,
      "loss": 0.149,
      "mae_dtheta": 0.010309484787285328,
      "mae_dx": 0.0017236528219655156,
      "mae_dy": 0.001786375418305397,
      "pose_mae_dtheta": 0.0751645416021347,
      "pose_mae_dx": 0.016164157539606094,
      "pose_mae_dy": 0.014606989920139313,
      "pose_rmse_dtheta": 0.26813820004463196,
      "pose_rmse_dx": 0.04791366308927536,
      "pose_rmse_dy": 0.04289582371711731,
      "pose_rmse_mean": 0.11964923143386841,
      "rmse_dtheta": 0.02994609624147415,
      "rmse_dx": 0.005227232351899147,
      "rmse_dy": 0.00644902978092432,
      "rmse_mean": 0.013874119147658348,
      "rotation_flip": 0.002026753034442663,
      "sparse_tokens": 32169.0,
      "step": 11854,
      "turn_loss": 0.07739654928445816,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5507805240661587,
      "grad_norm": 0.31808942556381226,
      "learning_rate": 3.726135429415467e-09,
      "loss": 0.0752,
      "mae_dtheta": 0.006875551305711269,
      "mae_dx": 0.0015003879088908434,
      "mae_dy": 0.002284660702571273,
      "pose_mae_dtheta": 0.04429682716727257,
      "pose_mae_dx": 0.020421070978045464,
      "pose_mae_dy": 0.02117837965488434,
      "pose_rmse_dtheta": 0.09601463377475739,
      "pose_rmse_dx": 0.05704415217041969,
      "pose_rmse_dy": 0.05493262782692909,
      "pose_rmse_mean": 0.06933046877384186,
      "rmse_dtheta": 0.014500909484922886,
      "rmse_dx": 0.00402095727622509,
      "rmse_dy": 0.005387009121477604,
      "rmse_mean": 0.007969625294208527,
      "rotation_flip": 0.0011411183513700962,
      "sparse_tokens": 32169.0,
      "step": 11855,
      "turn_loss": 0.06692083925008774,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5508269838320015,
      "grad_norm": 0.618262767791748,
      "learning_rate": 3.6752735156886377e-09,
      "loss": 0.1326,
      "mae_dtheta": 0.010843075811862946,
      "mae_dx": 0.0013868332607671618,
      "mae_dy": 0.0022435702849179506,
      "pose_mae_dtheta": 0.0703621357679367,
      "pose_mae_dx": 0.02263540029525757,
      "pose_mae_dy": 0.029851209372282028,
      "pose_rmse_dtheta": 0.16875654458999634,
      "pose_rmse_dx": 0.059486713260412216,
      "pose_rmse_dy": 0.07016461342573166,
      "pose_rmse_mean": 0.09946929663419724,
      "rmse_dtheta": 0.022850601002573967,
      "rmse_dx": 0.0048194099217653275,
      "rmse_dy": 0.004204564727842808,
      "rmse_mean": 0.010624858550727367,
      "rotation_flip": 0.0062592048197984695,
      "sparse_tokens": 32089.0,
      "step": 11856,
      "turn_loss": 0.08182650804519653,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5508734435978443,
      "grad_norm": 0.3873107433319092,
      "learning_rate": 3.6247609976319818e-09,
      "loss": 0.0992,
      "mae_dtheta": 0.009908749721944332,
      "mae_dx": 0.0018547673244029284,
      "mae_dy": 0.0021939314901828766,
      "pose_mae_dtheta": 0.06498485803604126,
      "pose_mae_dx": 0.020727183669805527,
      "pose_mae_dy": 0.023918189108371735,
      "pose_rmse_dtheta": 0.1402202695608139,
      "pose_rmse_dx": 0.05228911712765694,
      "pose_rmse_dy": 0.05685697868466377,
      "pose_rmse_mean": 0.083122119307518,
      "rmse_dtheta": 0.021044263616204262,
      "rmse_dx": 0.00588861433789134,
      "rmse_dy": 0.005661331582814455,
      "rmse_mean": 0.010864737443625927,
      "rotation_flip": 0.0077738515101373196,
      "sparse_tokens": 32169.0,
      "step": 11857,
      "turn_loss": 0.08088617771863937,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8462.0,
      "epoch": 0.550919903363687,
      "grad_norm": 0.6800574064254761,
      "learning_rate": 3.574597878777675e-09,
      "loss": 0.1537,
      "mae_dtheta": 0.026062453165650368,
      "mae_dx": 0.006950528360903263,
      "mae_dy": 0.005828176625072956,
      "pose_mae_dtheta": 0.22632449865341187,
      "pose_mae_dx": 0.06749196350574493,
      "pose_mae_dy": 0.081825390458107,
      "pose_rmse_dtheta": 0.3592393696308136,
      "pose_rmse_dx": 0.16315551102161407,
      "pose_rmse_dy": 0.17225299775600433,
      "pose_rmse_mean": 0.23154930770397186,
      "rmse_dtheta": 0.039799872785806656,
      "rmse_dx": 0.017437484115362167,
      "rmse_dy": 0.009710214100778103,
      "rmse_mean": 0.02231585793197155,
      "rotation_flip": 0.005464480724185705,
      "sparse_tokens": 6205.0,
      "step": 11858,
      "turn_loss": 0.23846739530563354,
      "turns": 26.0,
      "turns_per_sample": 26.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5509663631295298,
      "grad_norm": 0.3884740173816681,
      "learning_rate": 3.5247841626334654e-09,
      "loss": 0.0893,
      "mae_dtheta": 0.005149060860276222,
      "mae_dx": 0.0009285171399824321,
      "mae_dy": 0.000879836268723011,
      "pose_mae_dtheta": 0.03812069073319435,
      "pose_mae_dx": 0.008812296204268932,
      "pose_mae_dy": 0.012144334614276886,
      "pose_rmse_dtheta": 0.1412840634584427,
      "pose_rmse_dx": 0.01965481974184513,
      "pose_rmse_dy": 0.03325631096959114,
      "pose_rmse_mean": 0.06473173201084137,
      "rmse_dtheta": 0.015655718743801117,
      "rmse_dx": 0.002739082323387265,
      "rmse_dy": 0.0019154230831190944,
      "rmse_mean": 0.006770075298845768,
      "rotation_flip": 0.0016326530603691936,
      "sparse_tokens": 32169.0,
      "step": 11859,
      "turn_loss": 0.04231443256139755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64665.0,
      "epoch": 0.5510128228953726,
      "grad_norm": 0.45684829354286194,
      "learning_rate": 3.4753198526826794e-09,
      "loss": 0.0853,
      "mae_dtheta": 0.00766177149489522,
      "mae_dx": 0.0012944753980264068,
      "mae_dy": 0.0002128039486706257,
      "pose_mae_dtheta": 0.049369510263204575,
      "pose_mae_dx": 0.009531242772936821,
      "pose_mae_dy": 0.0025102400686591864,
      "pose_rmse_dtheta": 0.21903783082962036,
      "pose_rmse_dx": 0.019589733332395554,
      "pose_rmse_dy": 0.005562763661146164,
      "pose_rmse_mean": 0.08139678090810776,
      "rmse_dtheta": 0.02930755726993084,
      "rmse_dx": 0.0033546295017004013,
      "rmse_dy": 0.0006732704350724816,
      "rmse_mean": 0.011111820116639137,
      "rotation_flip": 0.0020586722530424595,
      "sparse_tokens": 32265.0,
      "step": 11860,
      "turn_loss": 0.04525153338909149,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 24909.0,
      "epoch": 0.5510592826612154,
      "grad_norm": 0.9317141175270081,
      "learning_rate": 3.4262049523847707e-09,
      "loss": 0.2041,
      "mae_dtheta": 0.03439219295978546,
      "mae_dx": 0.013019208796322346,
      "mae_dy": 0.004003892187029123,
      "pose_mae_dtheta": 0.2612333297729492,
      "pose_mae_dx": 0.10548529773950577,
      "pose_mae_dy": 0.04972336068749428,
      "pose_rmse_dtheta": 0.48322799801826477,
      "pose_rmse_dx": 0.22885768115520477,
      "pose_rmse_dy": 0.11757553368806839,
      "pose_rmse_mean": 0.276553750038147,
      "rmse_dtheta": 0.053528137505054474,
      "rmse_dx": 0.025994520634412766,
      "rmse_dy": 0.007315540220588446,
      "rmse_mean": 0.02894606441259384,
      "rotation_flip": 0.014084506779909134,
      "sparse_tokens": 20749.0,
      "step": 11861,
      "turn_loss": 0.22973379492759705,
      "turns": 77.0,
      "turns_per_sample": 77.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5511057424270581,
      "grad_norm": 0.28502076864242554,
      "learning_rate": 3.37743946517366e-09,
      "loss": 0.0671,
      "mae_dtheta": 0.004100457765161991,
      "mae_dx": 0.0009472219389863312,
      "mae_dy": 0.001004985417239368,
      "pose_mae_dtheta": 0.029548857361078262,
      "pose_mae_dx": 0.007671831175684929,
      "pose_mae_dy": 0.010965545661747456,
      "pose_rmse_dtheta": 0.09734632074832916,
      "pose_rmse_dx": 0.020351791754364967,
      "pose_rmse_dy": 0.03152088820934296,
      "pose_rmse_mean": 0.049739670008420944,
      "rmse_dtheta": 0.013119587674736977,
      "rmse_dx": 0.0041963947005569935,
      "rmse_dy": 0.0037841142620891333,
      "rmse_mean": 0.0070333657786250114,
      "rotation_flip": 0.0026472534518688917,
      "sparse_tokens": 32073.0,
      "step": 11862,
      "turn_loss": 0.03509092330932617,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.551152202192901,
      "grad_norm": 0.4134316146373749,
      "learning_rate": 3.3290233944605067e-09,
      "loss": 0.1062,
      "mae_dtheta": 0.007253927178680897,
      "mae_dx": 0.0011622178135439754,
      "mae_dy": 0.001959451474249363,
      "pose_mae_dtheta": 0.044480688869953156,
      "pose_mae_dx": 0.016274558380246162,
      "pose_mae_dy": 0.020331580191850662,
      "pose_rmse_dtheta": 0.09027732163667679,
      "pose_rmse_dx": 0.04484589397907257,
      "pose_rmse_dy": 0.049248091876506805,
      "pose_rmse_mean": 0.061457108706235886,
      "rmse_dtheta": 0.015391198918223381,
      "rmse_dx": 0.003542831400409341,
      "rmse_dy": 0.00464565958827734,
      "rmse_mean": 0.007859896868467331,
      "rotation_flip": 0.008525148965418339,
      "sparse_tokens": 32073.0,
      "step": 11863,
      "turn_loss": 0.06326326727867126,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5511986619587437,
      "grad_norm": 0.34171062707901,
      "learning_rate": 3.2809567436309364e-09,
      "loss": 0.0716,
      "mae_dtheta": 0.005515437573194504,
      "mae_dx": 0.0012859255075454712,
      "mae_dy": 0.001307963510043919,
      "pose_mae_dtheta": 0.04023668169975281,
      "pose_mae_dx": 0.013431154191493988,
      "pose_mae_dy": 0.015528530813753605,
      "pose_rmse_dtheta": 0.1326247602701187,
      "pose_rmse_dx": 0.052581675350666046,
      "pose_rmse_dy": 0.04680473357439041,
      "pose_rmse_mean": 0.07733705639839172,
      "rmse_dtheta": 0.01687772572040558,
      "rmse_dx": 0.005422126967459917,
      "rmse_dy": 0.003952768165618181,
      "rmse_mean": 0.008750873617827892,
      "rotation_flip": 0.004578155465424061,
      "sparse_tokens": 32057.0,
      "step": 11864,
      "turn_loss": 0.050632935017347336,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64553.0,
      "epoch": 0.5512451217245865,
      "grad_norm": 0.3880244493484497,
      "learning_rate": 3.2332395160455942e-09,
      "loss": 0.0729,
      "mae_dtheta": 0.0071204062551259995,
      "mae_dx": 0.0012743540573865175,
      "mae_dy": 0.0011724084615707397,
      "pose_mae_dtheta": 0.05274729058146477,
      "pose_mae_dx": 0.01020183227956295,
      "pose_mae_dy": 0.012106403708457947,
      "pose_rmse_dtheta": 0.19669021666049957,
      "pose_rmse_dx": 0.033597975969314575,
      "pose_rmse_dy": 0.027347441762685776,
      "pose_rmse_mean": 0.08587854355573654,
      "rmse_dtheta": 0.022795459255576134,
      "rmse_dx": 0.004481865093111992,
      "rmse_dy": 0.003538331249728799,
      "rmse_mean": 0.010271885432302952,
      "rotation_flip": 0.005400539841502905,
      "sparse_tokens": 32153.0,
      "step": 11865,
      "turn_loss": 0.05778759345412254,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.5512915814904293,
      "grad_norm": 0.6173216700553894,
      "learning_rate": 3.1858717150412554e-09,
      "loss": 0.1627,
      "mae_dtheta": 0.03280860558152199,
      "mae_dx": 0.014177478849887848,
      "mae_dy": 0.003544962964951992,
      "pose_mae_dtheta": 0.2691900134086609,
      "pose_mae_dx": 0.10484054684638977,
      "pose_mae_dy": 0.03817685693502426,
      "pose_rmse_dtheta": 0.49228808283805847,
      "pose_rmse_dx": 0.22159525752067566,
      "pose_rmse_dy": 0.09780293703079224,
      "pose_rmse_mean": 0.2705621123313904,
      "rmse_dtheta": 0.050549209117889404,
      "rmse_dx": 0.027258647605776787,
      "rmse_dy": 0.007301184814423323,
      "rmse_mean": 0.028369680047035217,
      "rotation_flip": 0.007668711710721254,
      "sparse_tokens": 11417.0,
      "step": 11866,
      "turn_loss": 0.24227827787399292,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.5513380412562721,
      "grad_norm": 0.5493718385696411,
      "learning_rate": 3.138853343931936e-09,
      "loss": 0.1122,
      "mae_dtheta": 0.0256172027438879,
      "mae_dx": 0.016310879960656166,
      "mae_dy": 0.003684417111799121,
      "pose_mae_dtheta": 0.21131452918052673,
      "pose_mae_dx": 0.11223696917295456,
      "pose_mae_dy": 0.04152277857065201,
      "pose_rmse_dtheta": 0.38663482666015625,
      "pose_rmse_dx": 0.2627508342266083,
      "pose_rmse_dy": 0.10489610582590103,
      "pose_rmse_mean": 0.2514272928237915,
      "rmse_dtheta": 0.042942825704813004,
      "rmse_dx": 0.030119523406028748,
      "rmse_dy": 0.007536856457591057,
      "rmse_mean": 0.026866402477025986,
      "rotation_flip": 0.009118541143834591,
      "sparse_tokens": 5754.0,
      "step": 11867,
      "turn_loss": 0.2208278775215149,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5513845010221149,
      "grad_norm": 0.43738090991973877,
      "learning_rate": 3.0921844060038954e-09,
      "loss": 0.1088,
      "mae_dtheta": 0.007061653304845095,
      "mae_dx": 0.001741232699714601,
      "mae_dy": 0.0019092049915343523,
      "pose_mae_dtheta": 0.044299133121967316,
      "pose_mae_dx": 0.018318217247724533,
      "pose_mae_dy": 0.021394990384578705,
      "pose_rmse_dtheta": 0.10362916439771652,
      "pose_rmse_dx": 0.05417022854089737,
      "pose_rmse_dy": 0.05594226345419884,
      "pose_rmse_mean": 0.07124722003936768,
      "rmse_dtheta": 0.016793347895145416,
      "rmse_dx": 0.006062174681574106,
      "rmse_dy": 0.0046192617155611515,
      "rmse_mean": 0.009158261120319366,
      "rotation_flip": 0.004790940787643194,
      "sparse_tokens": 32105.0,
      "step": 11868,
      "turn_loss": 0.07502362877130508,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 16239.0,
      "epoch": 0.5514309607879576,
      "grad_norm": 0.5275455713272095,
      "learning_rate": 3.0458649045211897e-09,
      "loss": 0.146,
      "mae_dtheta": 0.03655551001429558,
      "mae_dx": 0.009867224842309952,
      "mae_dy": 0.004947515670210123,
      "pose_mae_dtheta": 0.27078554034233093,
      "pose_mae_dx": 0.08399339020252228,
      "pose_mae_dy": 0.06006225571036339,
      "pose_rmse_dtheta": 0.46912214159965515,
      "pose_rmse_dx": 0.1870943158864975,
      "pose_rmse_dy": 0.1340944617986679,
      "pose_rmse_mean": 0.2634369730949402,
      "rmse_dtheta": 0.053993094712495804,
      "rmse_dx": 0.021929195150732994,
      "rmse_dy": 0.010020985268056393,
      "rmse_mean": 0.028647758066654205,
      "rotation_flip": 0.011873350478708744,
      "sparse_tokens": 13478.0,
      "step": 11869,
      "turn_loss": 0.32665252685546875,
      "turns": 50.0,
      "turns_per_sample": 50.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5514774205538004,
      "grad_norm": 0.4527956545352936,
      "learning_rate": 2.9998948427240047e-09,
      "loss": 0.1062,
      "mae_dtheta": 0.007655861787497997,
      "mae_dx": 0.0017851083539426327,
      "mae_dy": 0.0015857045073062181,
      "pose_mae_dtheta": 0.05822307989001274,
      "pose_mae_dx": 0.016241274774074554,
      "pose_mae_dy": 0.023204471915960312,
      "pose_rmse_dtheta": 0.145597442984581,
      "pose_rmse_dx": 0.05737907439470291,
      "pose_rmse_dy": 0.07241295278072357,
      "pose_rmse_mean": 0.09179650247097015,
      "rmse_dtheta": 0.018999693915247917,
      "rmse_dx": 0.007449987344443798,
      "rmse_dy": 0.005010064225643873,
      "rmse_mean": 0.010486582294106483,
      "rotation_flip": 0.0049291434697806835,
      "sparse_tokens": 32057.0,
      "step": 11870,
      "turn_loss": 0.06907261908054352,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14618.0,
      "epoch": 0.5515238803196432,
      "grad_norm": 0.9395027756690979,
      "learning_rate": 2.9542742238253263e-09,
      "loss": 0.2381,
      "mae_dtheta": 0.02310923859477043,
      "mae_dx": 0.010099094361066818,
      "mae_dy": 0.004355880431830883,
      "pose_mae_dtheta": 0.17218449711799622,
      "pose_mae_dx": 0.09028072655200958,
      "pose_mae_dy": 0.0609721802175045,
      "pose_rmse_dtheta": 0.30744853615760803,
      "pose_rmse_dx": 0.25524193048477173,
      "pose_rmse_dy": 0.1299123913049698,
      "pose_rmse_mean": 0.23086762428283691,
      "rmse_dtheta": 0.037302903831005096,
      "rmse_dx": 0.0249610785394907,
      "rmse_dy": 0.007990262471139431,
      "rmse_mean": 0.023418081924319267,
      "rotation_flip": 0.014869888313114643,
      "sparse_tokens": 12372.0,
      "step": 11871,
      "turn_loss": 0.19034495949745178,
      "turns": 45.0,
      "turns_per_sample": 45.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.551570340085486,
      "grad_norm": 0.5884390473365784,
      "learning_rate": 2.9090030510170454e-09,
      "loss": 0.1626,
      "mae_dtheta": 0.026304006576538086,
      "mae_dx": 0.007633349858224392,
      "mae_dy": 0.007697488181293011,
      "pose_mae_dtheta": 0.22104687988758087,
      "pose_mae_dx": 0.08100686967372894,
      "pose_mae_dy": 0.0952572301030159,
      "pose_rmse_dtheta": 0.4495451748371124,
      "pose_rmse_dx": 0.18194268643856049,
      "pose_rmse_dy": 0.19801729917526245,
      "pose_rmse_mean": 0.27650171518325806,
      "rmse_dtheta": 0.0462459996342659,
      "rmse_dx": 0.017241915687918663,
      "rmse_dy": 0.015072185546159744,
      "rmse_mean": 0.02618670091032982,
      "rotation_flip": 0.0075329565443098545,
      "sparse_tokens": 10537.0,
      "step": 11872,
      "turn_loss": 0.26479464769363403,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 34606.0,
      "epoch": 0.5516167998513287,
      "grad_norm": 0.631136953830719,
      "learning_rate": 2.8640813274638525e-09,
      "loss": 0.191,
      "mae_dtheta": 0.03359776362776756,
      "mae_dx": 0.012199526652693748,
      "mae_dy": 0.00432244036346674,
      "pose_mae_dtheta": 0.27476245164871216,
      "pose_mae_dx": 0.08742833882570267,
      "pose_mae_dy": 0.04782984033226967,
      "pose_rmse_dtheta": 0.4600808322429657,
      "pose_rmse_dx": 0.19162242114543915,
      "pose_rmse_dy": 0.1202973797917366,
      "pose_rmse_mean": 0.25733354687690735,
      "rmse_dtheta": 0.050403282046318054,
      "rmse_dx": 0.024157142266631126,
      "rmse_dy": 0.008417408913373947,
      "rmse_mean": 0.027659278362989426,
      "rotation_flip": 0.016149068251252174,
      "sparse_tokens": 26974.0,
      "step": 11873,
      "turn_loss": 0.26452502608299255,
      "turns": 107.0,
      "turns_per_sample": 107.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5516632596171716,
      "grad_norm": 0.4602590501308441,
      "learning_rate": 2.8195090563076786e-09,
      "loss": 0.1197,
      "mae_dtheta": 0.006609613075852394,
      "mae_dx": 0.0009787800954654813,
      "mae_dy": 0.0014853263273835182,
      "pose_mae_dtheta": 0.0417773500084877,
      "pose_mae_dx": 0.012691927142441273,
      "pose_mae_dy": 0.01887567527592182,
      "pose_rmse_dtheta": 0.10483681410551071,
      "pose_rmse_dx": 0.03453992307186127,
      "pose_rmse_dy": 0.043013788759708405,
      "pose_rmse_mean": 0.060796838253736496,
      "rmse_dtheta": 0.01583566702902317,
      "rmse_dx": 0.0032439313363283873,
      "rmse_dy": 0.003300662152469158,
      "rmse_mean": 0.007460086606442928,
      "rotation_flip": 0.001323334756307304,
      "sparse_tokens": 32089.0,
      "step": 11874,
      "turn_loss": 0.050818461924791336,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5517097193830143,
      "grad_norm": 0.4413956105709076,
      "learning_rate": 2.7752862406654755e-09,
      "loss": 0.1019,
      "mae_dtheta": 0.010194610804319382,
      "mae_dx": 0.002326361136510968,
      "mae_dy": 0.002567554824054241,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.44139569997787476,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 155.70814514160156,
      "model/head/act_norm_mean": 99.92716224747475,
      "model/head/act_norm_min": 63.862876892089844,
      "model/head/act_over_embed": 68.67088142929717,
      "model/head/grad_frac": 0.11014331132173538,
      "model/head/grad_norm": 0.04861678555607796,
      "model/head/grad_zero_frac": 0.0001583186094649136,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7120127051767676,
      "model/head/update_ratio": 0.0008275905274786055,
      "model/head/weight_delta": 9.986133575439453,
      "model/head/weight_delta_rel": 0.1751863658428192,
      "model/head/weight_norm": 58.74497604370117,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.4229294955730438,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228662396760265,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42280253767967224,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905976388414753,
      "model/modality_embedder.encoders.pose/grad_frac": 0.089722640812397,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03960318863391876,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5462619114349776,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0012787653831765056,
      "model/modality_embedder.encoders.pose/weight_delta": 3.156934976577759,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314690321683884,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96986198425293,
      "model/modality_embedder/grad_frac": 0.089722640812397,
      "model/modality_embedder/grad_norm": 0.03960318863391876,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5462619114349776,
      "model/modality_embedder/update_ratio": 0.0012787653831765056,
      "model/modality_embedder/weight_delta": 3.156934976577759,
      "model/modality_embedder/weight_delta_rel": 0.10314690321683884,
      "model/modality_embedder/weight_norm": 30.96986198425293,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.49889373779297,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.631834215167547,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.03842830657959,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.552808355233326,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0692514106631279,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03056727536022663,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001093200291506946,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7429394721984863,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995436668395996,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.96127700805664,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.2232437133789,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.580622695206028,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.376313209533691,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.20482468141347,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07671552896499634,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.033861905336380005,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011374130845069885,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.477707624435425,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12047050893306732,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77098274230957,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 89.18377685546875,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.379627124418793,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.424765586853027,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.441117367713307,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07459304481744766,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03292505070567131,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001613944477867335,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0010709920898079872,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7677159309387207,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12651284039020538,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742572784423828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 89.7856674194336,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.125435906685908,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.56401252746582,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.6408535074066,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.07152602076530457,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03157127648591995,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00013113298336975276,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0010539285140112042,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.238779067993164,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11068610101938248,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9558048248291,
      "model/normalizer/grad_frac": 0.27703848481178284,
      "model/normalizer/grad_norm": 0.12228359282016754,
      "model/normalizer/grad_zero_frac": 0.0001855329319369048,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0015546204522252083,
      "model/normalizer/weight_delta": 6.810950756072998,
      "model/normalizer/weight_delta_rel": 0.08772110193967819,
      "model/normalizer/weight_norm": 78.65816497802734,
      "pose_mae_dtheta": 0.0642906054854393,
      "pose_mae_dx": 0.02374817430973053,
      "pose_mae_dy": 0.030850235372781754,
      "pose_rmse_dtheta": 0.15056836605072021,
      "pose_rmse_dx": 0.06712576746940613,
      "pose_rmse_dy": 0.08273789286613464,
      "pose_rmse_mean": 0.10014401376247406,
      "rmse_dtheta": 0.02151758410036564,
      "rmse_dx": 0.00730404956266284,
      "rmse_dy": 0.006122784689068794,
      "rmse_mean": 0.011648139916360378,
      "rotation_flip": 0.004268943332135677,
      "sparse_tokens": 32105.0,
      "step": 11875,
      "turn_loss": 0.10553143918514252,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5517561791488571,
      "grad_norm": 0.4885258674621582,
      "learning_rate": 2.7314128836297692e-09,
      "loss": 0.0753,
      "mae_dtheta": 0.005950739607214928,
      "mae_dx": 0.0016750668874010444,
      "mae_dy": 0.0014516918454319239,
      "pose_mae_dtheta": 0.04442142695188522,
      "pose_mae_dx": 0.01835508644580841,
      "pose_mae_dy": 0.019617516547441483,
      "pose_rmse_dtheta": 0.12345521152019501,
      "pose_rmse_dx": 0.06365161389112473,
      "pose_rmse_dy": 0.07471688836812973,
      "pose_rmse_mean": 0.08727457374334335,
      "rmse_dtheta": 0.01606258749961853,
      "rmse_dx": 0.0063425288535654545,
      "rmse_dy": 0.004435430280864239,
      "rmse_mean": 0.008946849033236504,
      "rotation_flip": 0.00193050189409405,
      "sparse_tokens": 32073.0,
      "step": 11876,
      "turn_loss": 0.05322210118174553,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5518026389146998,
      "grad_norm": 0.663762092590332,
      "learning_rate": 2.6878889882681056e-09,
      "loss": 0.142,
      "mae_dtheta": 0.007589602377265692,
      "mae_dx": 0.0012620453489944339,
      "mae_dy": 0.001469254377298057,
      "pose_mae_dtheta": 0.051945704966783524,
      "pose_mae_dx": 0.013092023320496082,
      "pose_mae_dy": 0.0175378005951643,
      "pose_rmse_dtheta": 0.16342900693416595,
      "pose_rmse_dx": 0.03512850031256676,
      "pose_rmse_dy": 0.05436820536851883,
      "pose_rmse_mean": 0.08430857956409454,
      "rmse_dtheta": 0.01940198242664337,
      "rmse_dx": 0.0036814508493989706,
      "rmse_dy": 0.0038097186479717493,
      "rmse_mean": 0.008964383974671364,
      "rotation_flip": 0.0018932222155854106,
      "sparse_tokens": 32185.0,
      "step": 11877,
      "turn_loss": 0.07032959163188934,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 8113.0,
      "epoch": 0.5518490986805427,
      "grad_norm": 0.4239825904369354,
      "learning_rate": 2.644714557625272e-09,
      "loss": 0.1176,
      "mae_dtheta": 0.039616040885448456,
      "mae_dx": 0.01327322144061327,
      "mae_dy": 0.004868107382208109,
      "pose_mae_dtheta": 0.3369717299938202,
      "pose_mae_dx": 0.10296331346035004,
      "pose_mae_dy": 0.05597936362028122,
      "pose_rmse_dtheta": 0.5402798056602478,
      "pose_rmse_dx": 0.1990206092596054,
      "pose_rmse_dy": 0.12920469045639038,
      "pose_rmse_mean": 0.28950172662734985,
      "rmse_dtheta": 0.05790519341826439,
      "rmse_dx": 0.024355405941605568,
      "rmse_dy": 0.010155747644603252,
      "rmse_mean": 0.030805449932813644,
      "rotation_flip": 0.011990407481789589,
      "sparse_tokens": 6606.0,
      "step": 11878,
      "turn_loss": 0.27477213740348816,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 31466.0,
      "epoch": 0.5518955584463854,
      "grad_norm": 0.9159184098243713,
      "learning_rate": 2.601889594719409e-09,
      "loss": 0.2398,
      "mae_dtheta": 0.027073964476585388,
      "mae_dx": 0.008472179993987083,
      "mae_dy": 0.002958237426355481,
      "pose_mae_dtheta": 0.19357909262180328,
      "pose_mae_dx": 0.06877101212739944,
      "pose_mae_dy": 0.03431994095444679,
      "pose_rmse_dtheta": 0.3822764754295349,
      "pose_rmse_dx": 0.17744064331054688,
      "pose_rmse_dy": 0.09065268933773041,
      "pose_rmse_mean": 0.21678994596004486,
      "rmse_dtheta": 0.04608432576060295,
      "rmse_dx": 0.020161837339401245,
      "rmse_dy": 0.006418221164494753,
      "rmse_mean": 0.02422146312892437,
      "rotation_flip": 0.011904762126505375,
      "sparse_tokens": 25037.0,
      "step": 11879,
      "turn_loss": 0.20320601761341095,
      "turns": 97.0,
      "turns_per_sample": 97.0
    },
    {
      "dense_tokens": 11344.0,
      "epoch": 0.5519420182122282,
      "grad_norm": 0.45863965153694153,
      "learning_rate": 2.5594141025453435e-09,
      "loss": 0.1011,
      "mae_dtheta": 0.04161441698670387,
      "mae_dx": 0.007774408906698227,
      "mae_dy": 0.002976836869493127,
      "pose_mae_dtheta": 0.3360570967197418,
      "pose_mae_dx": 0.05338200554251671,
      "pose_mae_dy": 0.03185685724020004,
      "pose_rmse_dtheta": 0.6649473309516907,
      "pose_rmse_dx": 0.15948589146137238,
      "pose_rmse_dy": 0.07491956651210785,
      "pose_rmse_mean": 0.29978427290916443,
      "rmse_dtheta": 0.06602953374385834,
      "rmse_dx": 0.019128261134028435,
      "rmse_dy": 0.005628975108265877,
      "rmse_mean": 0.030262257903814316,
      "rotation_flip": 0.014285714365541935,
      "sparse_tokens": 9462.0,
      "step": 11880,
      "turn_loss": 0.2348681539297104,
      "turns": 35.0,
      "turns_per_sample": 35.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.551988477978071,
      "grad_norm": 0.6004710793495178,
      "learning_rate": 2.5172880840745873e-09,
      "loss": 0.1207,
      "mae_dtheta": 0.019786302000284195,
      "mae_dx": 0.0022620882373303175,
      "mae_dy": 0.0022672819904983044,
      "pose_mae_dtheta": 0.1781381368637085,
      "pose_mae_dx": 0.013466925360262394,
      "pose_mae_dy": 0.02245328202843666,
      "pose_rmse_dtheta": 0.4269047975540161,
      "pose_rmse_dx": 0.03786800429224968,
      "pose_rmse_dy": 0.0544588603079319,
      "pose_rmse_mean": 0.17307722568511963,
      "rmse_dtheta": 0.04127464070916176,
      "rmse_dx": 0.006689979694783688,
      "rmse_dy": 0.005704313982278109,
      "rmse_mean": 0.01788964495062828,
      "rotation_flip": 0.012658228166401386,
      "sparse_tokens": 5066.0,
      "step": 11881,
      "turn_loss": 0.12787120044231415,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 21356.0,
      "epoch": 0.5520349377439138,
      "grad_norm": 0.4574969410896301,
      "learning_rate": 2.475511542251452e-09,
      "loss": 0.1385,
      "mae_dtheta": 0.03196756914258003,
      "mae_dx": 0.01367766223847866,
      "mae_dy": 0.006830449681729078,
      "pose_mae_dtheta": 0.25420790910720825,
      "pose_mae_dx": 0.11117319017648697,
      "pose_mae_dy": 0.09624113142490387,
      "pose_rmse_dtheta": 0.4336261451244354,
      "pose_rmse_dx": 0.23757317662239075,
      "pose_rmse_dy": 0.2131109982728958,
      "pose_rmse_mean": 0.29477012157440186,
      "rmse_dtheta": 0.046182695776224136,
      "rmse_dx": 0.027779079973697662,
      "rmse_dy": 0.012488441541790962,
      "rmse_mean": 0.028816740959882736,
      "rotation_flip": 0.014573991298675537,
      "sparse_tokens": 16589.0,
      "step": 11882,
      "turn_loss": 0.27252838015556335,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5520813975097566,
      "grad_norm": 0.591404378414154,
      "learning_rate": 2.4340844799985996e-09,
      "loss": 0.1198,
      "mae_dtheta": 0.006081605330109596,
      "mae_dx": 0.0009898340795189142,
      "mae_dy": 0.0002619196893647313,
      "pose_mae_dtheta": 0.046722881495952606,
      "pose_mae_dx": 0.00724187633022666,
      "pose_mae_dy": 0.0038585392758250237,
      "pose_rmse_dtheta": 0.23829922080039978,
      "pose_rmse_dx": 0.017823226749897003,
      "pose_rmse_dy": 0.020561562851071358,
      "pose_rmse_mean": 0.0922280102968216,
      "rmse_dtheta": 0.026089146733283997,
      "rmse_dx": 0.0031377538107335567,
      "rmse_dy": 0.0009010871290229261,
      "rmse_mean": 0.010042662732303143,
      "rotation_flip": 0.0021582734771072865,
      "sparse_tokens": 32169.0,
      "step": 11883,
      "turn_loss": 0.035775475203990936,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5521278572755993,
      "grad_norm": 0.3539275527000427,
      "learning_rate": 2.393006900212047e-09,
      "loss": 0.0653,
      "mae_dtheta": 0.007937625050544739,
      "mae_dx": 0.0011782502988353372,
      "mae_dy": 0.001703619142062962,
      "pose_mae_dtheta": 0.053345415741205215,
      "pose_mae_dx": 0.014768811874091625,
      "pose_mae_dy": 0.019573496654629707,
      "pose_rmse_dtheta": 0.15391720831394196,
      "pose_rmse_dx": 0.04154771938920021,
      "pose_rmse_dy": 0.046577028930187225,
      "pose_rmse_mean": 0.08068065345287323,
      "rmse_dtheta": 0.019207244738936424,
      "rmse_dx": 0.004132075235247612,
      "rmse_dy": 0.0040415506809949875,
      "rmse_mean": 0.009126957505941391,
      "rotation_flip": 0.0043290043249726295,
      "sparse_tokens": 32073.0,
      "step": 11884,
      "turn_loss": 0.06320846080780029,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5521743170414422,
      "grad_norm": 0.3955018222332001,
      "learning_rate": 2.3522788057656065e-09,
      "loss": 0.0778,
      "mae_dtheta": 0.008882414549589157,
      "mae_dx": 0.001441566157154739,
      "mae_dy": 0.0019542642403393984,
      "pose_mae_dtheta": 0.05997396260499954,
      "pose_mae_dx": 0.019827473908662796,
      "pose_mae_dy": 0.026873571798205376,
      "pose_rmse_dtheta": 0.16007253527641296,
      "pose_rmse_dx": 0.05565826594829559,
      "pose_rmse_dy": 0.06964088976383209,
      "pose_rmse_mean": 0.09512390196323395,
      "rmse_dtheta": 0.019739151000976562,
      "rmse_dx": 0.004969697445631027,
      "rmse_dy": 0.004556207451969385,
      "rmse_mean": 0.009755019098520279,
      "rotation_flip": 0.001816530479118228,
      "sparse_tokens": 32057.0,
      "step": 11885,
      "turn_loss": 0.07357554137706757,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.5522207768072849,
      "grad_norm": 0.5525513291358948,
      "learning_rate": 2.311900199506445e-09,
      "loss": 0.1385,
      "mae_dtheta": 0.02887287363409996,
      "mae_dx": 0.00971120223402977,
      "mae_dy": 0.003950556740164757,
      "pose_mae_dtheta": 0.23009927570819855,
      "pose_mae_dx": 0.07681240886449814,
      "pose_mae_dy": 0.04868987575173378,
      "pose_rmse_dtheta": 0.43034911155700684,
      "pose_rmse_dx": 0.1876840740442276,
      "pose_rmse_dy": 0.1212097555398941,
      "pose_rmse_mean": 0.24641430377960205,
      "rmse_dtheta": 0.04769696667790413,
      "rmse_dx": 0.02135150507092476,
      "rmse_dy": 0.008073009550571442,
      "rmse_mean": 0.02570716105401516,
      "rotation_flip": 0.014395393431186676,
      "sparse_tokens": 17448.0,
      "step": 11886,
      "turn_loss": 0.20462819933891296,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5522672365731277,
      "grad_norm": 0.4381561577320099,
      "learning_rate": 2.2718710842584145e-09,
      "loss": 0.0791,
      "mae_dtheta": 0.007997329346835613,
      "mae_dx": 0.0017104828730225563,
      "mae_dy": 0.0015723498072475195,
      "pose_mae_dtheta": 0.059243861585855484,
      "pose_mae_dx": 0.017061816528439522,
      "pose_mae_dy": 0.0177652258425951,
      "pose_rmse_dtheta": 0.1997053474187851,
      "pose_rmse_dx": 0.05983074754476547,
      "pose_rmse_dy": 0.055352434515953064,
      "pose_rmse_mean": 0.10496284812688828,
      "rmse_dtheta": 0.022785698994994164,
      "rmse_dx": 0.005891900509595871,
      "rmse_dy": 0.0051328325644135475,
      "rmse_mean": 0.011270144954323769,
      "rotation_flip": 0.006844626739621162,
      "sparse_tokens": 32089.0,
      "step": 11887,
      "turn_loss": 0.06255415081977844,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5523136963389704,
      "grad_norm": 0.4892441928386688,
      "learning_rate": 2.232191462820388e-09,
      "loss": 0.0943,
      "mae_dtheta": 0.010542535223066807,
      "mae_dx": 0.002625134540721774,
      "mae_dy": 0.0030081281438469887,
      "pose_mae_dtheta": 0.07232782244682312,
      "pose_mae_dx": 0.028775103390216827,
      "pose_mae_dy": 0.03378457576036453,
      "pose_rmse_dtheta": 0.1956387758255005,
      "pose_rmse_dx": 0.0849897712469101,
      "pose_rmse_dy": 0.11360888183116913,
      "pose_rmse_mean": 0.13141249120235443,
      "rmse_dtheta": 0.025242093950510025,
      "rmse_dx": 0.008481347002089024,
      "rmse_dy": 0.00943384412676096,
      "rmse_mean": 0.014385761693120003,
      "rotation_flip": 0.0038610037881881,
      "sparse_tokens": 32057.0,
      "step": 11888,
      "turn_loss": 0.10542062669992447,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 29198.0,
      "epoch": 0.5523601561048133,
      "grad_norm": 0.519830048084259,
      "learning_rate": 2.192861337968477e-09,
      "loss": 0.1779,
      "mae_dtheta": 0.03749663010239601,
      "mae_dx": 0.012013445608317852,
      "mae_dy": 0.005085348151624203,
      "pose_mae_dtheta": 0.28329163789749146,
      "pose_mae_dx": 0.08840087056159973,
      "pose_mae_dy": 0.057825349271297455,
      "pose_rmse_dtheta": 0.4714513123035431,
      "pose_rmse_dx": 0.19015659391880035,
      "pose_rmse_dy": 0.1379285603761673,
      "pose_rmse_mean": 0.2665121555328369,
      "rmse_dtheta": 0.05497724562883377,
      "rmse_dx": 0.02372625842690468,
      "rmse_dy": 0.010380133986473083,
      "rmse_mean": 0.02969454787671566,
      "rotation_flip": 0.012345679104328156,
      "sparse_tokens": 24698.0,
      "step": 11889,
      "turn_loss": 0.261773943901062,
      "turns": 90.0,
      "turns_per_sample": 90.0
    },
    {
      "dense_tokens": 10407.0,
      "epoch": 0.552406615870656,
      "grad_norm": 1.1874650716781616,
      "learning_rate": 2.15388071245215e-09,
      "loss": 0.2088,
      "mae_dtheta": 0.03568510338664055,
      "mae_dx": 0.012872641906142235,
      "mae_dy": 0.003953950479626656,
      "pose_mae_dtheta": 0.28962332010269165,
      "pose_mae_dx": 0.0937451645731926,
      "pose_mae_dy": 0.03295675292611122,
      "pose_rmse_dtheta": 0.5558887720108032,
      "pose_rmse_dx": 0.22370176017284393,
      "pose_rmse_dy": 0.07241345942020416,
      "pose_rmse_mean": 0.28400135040283203,
      "rmse_dtheta": 0.057157792150974274,
      "rmse_dx": 0.026541203260421753,
      "rmse_dy": 0.008017533458769321,
      "rmse_mean": 0.030572175979614258,
      "rotation_flip": 0.012406948022544384,
      "sparse_tokens": 9120.0,
      "step": 11890,
      "turn_loss": 0.20478874444961548,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5524530756364988,
      "grad_norm": 0.5169647932052612,
      "learning_rate": 2.1152495889970035e-09,
      "loss": 0.1331,
      "mae_dtheta": 0.0089659933000803,
      "mae_dx": 0.0015124614583328366,
      "mae_dy": 0.0021915894467383623,
      "pose_mae_dtheta": 0.05760576203465462,
      "pose_mae_dx": 0.019056977704167366,
      "pose_mae_dy": 0.025499606505036354,
      "pose_rmse_dtheta": 0.13066531717777252,
      "pose_rmse_dx": 0.0496334545314312,
      "pose_rmse_dy": 0.06152728199958801,
      "pose_rmse_mean": 0.08060868829488754,
      "rmse_dtheta": 0.018563292920589447,
      "rmse_dx": 0.004660506267100573,
      "rmse_dy": 0.005033715628087521,
      "rmse_mean": 0.009419172070920467,
      "rotation_flip": 0.003664345946162939,
      "sparse_tokens": 32121.0,
      "step": 11891,
      "turn_loss": 0.06649796664714813,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5524995354023415,
      "grad_norm": 0.3258740305900574,
      "learning_rate": 2.0769679703053214e-09,
      "loss": 0.0677,
      "mae_dtheta": 0.012457790784537792,
      "mae_dx": 0.0028450924437493086,
      "mae_dy": 0.004008977673947811,
      "pose_mae_dtheta": 0.09085677564144135,
      "pose_mae_dx": 0.03620593249797821,
      "pose_mae_dy": 0.03850039094686508,
      "pose_rmse_dtheta": 0.20391665399074554,
      "pose_rmse_dx": 0.10110610723495483,
      "pose_rmse_dy": 0.07852137833833694,
      "pose_rmse_mean": 0.1278480589389801,
      "rmse_dtheta": 0.025770509615540504,
      "rmse_dx": 0.008557824417948723,
      "rmse_dy": 0.00877756904810667,
      "rmse_mean": 0.014368634670972824,
      "rotation_flip": 0.007198953069746494,
      "sparse_tokens": 32105.0,
      "step": 11892,
      "turn_loss": 0.11209878325462341,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5525459951681844,
      "grad_norm": 0.5904954671859741,
      "learning_rate": 2.0390358590538507e-09,
      "loss": 0.0988,
      "mae_dtheta": 0.005757354665547609,
      "mae_dx": 0.001420848537236452,
      "mae_dy": 0.0015927120111882687,
      "pose_mae_dtheta": 0.03885889798402786,
      "pose_mae_dx": 0.016186917200684547,
      "pose_mae_dy": 0.017017440870404243,
      "pose_rmse_dtheta": 0.08774471282958984,
      "pose_rmse_dx": 0.04608551785349846,
      "pose_rmse_dy": 0.04046023264527321,
      "pose_rmse_mean": 0.05809682235121727,
      "rmse_dtheta": 0.013699188828468323,
      "rmse_dx": 0.004748107399791479,
      "rmse_dy": 0.003818476339802146,
      "rmse_mean": 0.0074219247326254845,
      "rotation_flip": 0.0018281536176800728,
      "sparse_tokens": 32089.0,
      "step": 11893,
      "turn_loss": 0.04893741384148598,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5525924549340271,
      "grad_norm": 0.5808648467063904,
      "learning_rate": 2.0014532578949143e-09,
      "loss": 0.1343,
      "mae_dtheta": 0.00788974855095148,
      "mae_dx": 0.0013879486359655857,
      "mae_dy": 0.0016113060992211103,
      "pose_mae_dtheta": 0.048497214913368225,
      "pose_mae_dx": 0.015295405872166157,
      "pose_mae_dy": 0.023495320230722427,
      "pose_rmse_dtheta": 0.10108721256256104,
      "pose_rmse_dx": 0.03616859018802643,
      "pose_rmse_dy": 0.05494176596403122,
      "pose_rmse_mean": 0.0640658587217331,
      "rmse_dtheta": 0.015675174072384834,
      "rmse_dx": 0.004605805967003107,
      "rmse_dy": 0.0033314740285277367,
      "rmse_mean": 0.007870818488299847,
      "rotation_flip": 0.0015772870974615216,
      "sparse_tokens": 32121.0,
      "step": 11894,
      "turn_loss": 0.07395928353071213,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10730.0,
      "epoch": 0.5526389146998699,
      "grad_norm": 0.5584052801132202,
      "learning_rate": 1.9642201694575203e-09,
      "loss": 0.0888,
      "mae_dtheta": 0.02310406044125557,
      "mae_dx": 0.006046336609870195,
      "mae_dy": 0.004221817012876272,
      "pose_mae_dtheta": 0.17479664087295532,
      "pose_mae_dx": 0.053612347692251205,
      "pose_mae_dy": 0.056202515959739685,
      "pose_rmse_dtheta": 0.33500179648399353,
      "pose_rmse_dx": 0.12257908284664154,
      "pose_rmse_dy": 0.13813427090644836,
      "pose_rmse_mean": 0.19857172667980194,
      "rmse_dtheta": 0.03898508474230766,
      "rmse_dx": 0.016121983528137207,
      "rmse_dy": 0.0084385322406888,
      "rmse_mean": 0.0211818665266037,
      "rotation_flip": 0.008247422985732555,
      "sparse_tokens": 8238.0,
      "step": 11895,
      "turn_loss": 0.17182381451129913,
      "turns": 33.0,
      "turns_per_sample": 33.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5526853744657126,
      "grad_norm": 0.3365131914615631,
      "learning_rate": 1.9273365963440315e-09,
      "loss": 0.066,
      "mae_dtheta": 0.0076987710781395435,
      "mae_dx": 0.0009354194044135511,
      "mae_dy": 0.0015356522053480148,
      "pose_mae_dtheta": 0.046466320753097534,
      "pose_mae_dx": 0.014218314550817013,
      "pose_mae_dy": 0.022781549021601677,
      "pose_rmse_dtheta": 0.09703806787729263,
      "pose_rmse_dx": 0.03892063722014427,
      "pose_rmse_dy": 0.059220753610134125,
      "pose_rmse_mean": 0.06505982577800751,
      "rmse_dtheta": 0.01566208340227604,
      "rmse_dx": 0.0032772270496934652,
      "rmse_dy": 0.003568686544895172,
      "rmse_mean": 0.007502665743231773,
      "rotation_flip": 0.0018239853670820594,
      "sparse_tokens": 32041.0,
      "step": 11896,
      "turn_loss": 0.05981966480612755,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.5527318342315555,
      "grad_norm": 0.7203579545021057,
      "learning_rate": 1.8908025411351617e-09,
      "loss": 0.1481,
      "mae_dtheta": 0.005215045530349016,
      "mae_dx": 0.0012100234162062407,
      "mae_dy": 0.0011906976578757167,
      "pose_mae_dtheta": 0.03179098293185234,
      "pose_mae_dx": 0.012448016554117203,
      "pose_mae_dy": 0.014056249521672726,
      "pose_rmse_dtheta": 0.06279630959033966,
      "pose_rmse_dx": 0.042262472212314606,
      "pose_rmse_dy": 0.034562673419713974,
      "pose_rmse_mean": 0.046540483832359314,
      "rmse_dtheta": 0.011389408260583878,
      "rmse_dx": 0.003981014247983694,
      "rmse_dy": 0.002771316794678569,
      "rmse_mean": 0.006047246512025595,
      "rotation_flip": 0.007429420482367277,
      "sparse_tokens": 32201.0,
      "step": 11897,
      "turn_loss": 0.04827004671096802,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64585.0,
      "epoch": 0.5527782939973983,
      "grad_norm": 0.42492344975471497,
      "learning_rate": 1.8546180063849783e-09,
      "loss": 0.0596,
      "mae_dtheta": 0.005354185122996569,
      "mae_dx": 0.0017952712951228023,
      "mae_dy": 0.0006851237849332392,
      "pose_mae_dtheta": 0.036710307002067566,
      "pose_mae_dx": 0.013788067735731602,
      "pose_mae_dy": 0.008566787466406822,
      "pose_rmse_dtheta": 0.13262148201465607,
      "pose_rmse_dx": 0.06312064081430435,
      "pose_rmse_dy": 0.034589268267154694,
      "pose_rmse_mean": 0.0767771303653717,
      "rmse_dtheta": 0.019331693649291992,
      "rmse_dx": 0.006735855247825384,
      "rmse_dy": 0.0022317711263895035,
      "rmse_mean": 0.009433107450604439,
      "rotation_flip": 0.0021965953055769205,
      "sparse_tokens": 32185.0,
      "step": 11898,
      "turn_loss": 0.0507851280272007,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13928.0,
      "epoch": 0.552824753763241,
      "grad_norm": 0.868332028388977,
      "learning_rate": 1.8187829946236802e-09,
      "loss": 0.1643,
      "mae_dtheta": 0.025694414973258972,
      "mae_dx": 0.008382011204957962,
      "mae_dy": 0.004194949753582478,
      "pose_mae_dtheta": 0.22288301587104797,
      "pose_mae_dx": 0.08475086838006973,
      "pose_mae_dy": 0.07148361951112747,
      "pose_rmse_dtheta": 0.4133465588092804,
      "pose_rmse_dx": 0.22822341322898865,
      "pose_rmse_dy": 0.16019003093242645,
      "pose_rmse_mean": 0.2672533392906189,
      "rmse_dtheta": 0.042691122740507126,
      "rmse_dx": 0.021627549082040787,
      "rmse_dy": 0.008028578013181686,
      "rmse_mean": 0.024115752428770065,
      "rotation_flip": 0.01886792480945587,
      "sparse_tokens": 11148.0,
      "step": 11899,
      "turn_loss": 0.166878804564476,
      "turns": 43.0,
      "turns_per_sample": 43.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5528712135290839,
      "grad_norm": 0.5067548155784607,
      "learning_rate": 1.7832975083581506e-09,
      "loss": 0.1347,
      "mae_dtheta": 0.010072737000882626,
      "mae_dx": 0.0025038570165634155,
      "mae_dy": 0.003299211384728551,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5067547559738159,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.14697265625,
      "model/head/act_norm_mean": 110.7145478219697,
      "model/head/act_norm_min": 40.4705810546875,
      "model/head/act_over_embed": 76.08407378918503,
      "model/head/grad_frac": 0.13857679069042206,
      "model/head/grad_norm": 0.07022444903850555,
      "model/head/grad_zero_frac": 0.0001637122331885621,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7066662720959596,
      "model/head/update_ratio": 0.0011954118963330984,
      "model/head/weight_delta": 9.986137390136719,
      "model/head/weight_delta_rel": 0.175186425447464,
      "model/head/weight_norm": 58.7449836730957,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42295241355895996,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42286757396475616,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4227874279022217,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059855577718213,
      "model/modality_embedder.encoders.pose/grad_frac": 0.10462523996829987,
      "model/modality_embedder.encoders.pose/grad_norm": 0.053019337356090546,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5402536434977578,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0017119655385613441,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569371223449707,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1031469777226448,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96986198425293,
      "model/modality_embedder/grad_frac": 0.10462523996829987,
      "model/modality_embedder/grad_norm": 0.053019337356090546,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5402536434977578,
      "model/modality_embedder/update_ratio": 0.0017119655385613441,
      "model/modality_embedder/weight_delta": 3.1569371223449707,
      "model/modality_embedder/weight_delta_rel": 0.1031469777226448,
      "model/modality_embedder/weight_norm": 30.96986198425293,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 85.98065185546875,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.73308732162899,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.025313377380371,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.30959980008765,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07215861231088638,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.03656671941280365,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00021183020726311952,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013077628100290895,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7429420948028564,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995446354150772,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961278915405273,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 87.93051147460938,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.71305315055315,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.358785629272461,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.98304149230897,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07067227363586426,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03581351041793823,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0012029670178890228,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.477710485458374,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12047060579061508,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77098274230957,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 90.10490417480469,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.542686287477956,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.510231971740723,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.240382513299,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.07098555564880371,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.035972267389297485,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002521788119338453,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0011701124021783471,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7677195072174072,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.12651295959949493,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742572784423828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 90.8778076171875,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.28877314814815,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.321556091308594,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.440309751074302,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.05855550989508629,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.02967328391969204,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00026730954414233565,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.000990568776614964,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2387824058532715,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.11068621277809143,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9558048248291,
      "model/normalizer/grad_frac": 0.20877163112163544,
      "model/normalizer/grad_norm": 0.10579601675271988,
      "model/normalizer/grad_zero_frac": 0.0002458015806041658,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.001345010008662939,
      "model/normalizer/weight_delta": 6.810957908630371,
      "model/normalizer/weight_delta_rel": 0.08772119134664536,
      "model/normalizer/weight_norm": 78.65816497802734,
      "pose_mae_dtheta": 0.066461943089962,
      "pose_mae_dx": 0.024060487747192383,
      "pose_mae_dy": 0.02630932629108429,
      "pose_rmse_dtheta": 0.20608572661876678,
      "pose_rmse_dx": 0.0891420915722847,
      "pose_rmse_dy": 0.10136903822422028,
      "pose_rmse_mean": 0.13219895958900452,
      "rmse_dtheta": 0.02660696767270565,
      "rmse_dx": 0.009030288085341454,
      "rmse_dy": 0.010715685784816742,
      "rmse_mean": 0.015450980514287949,
      "rotation_flip": 0.004221190232783556,
      "sparse_tokens": 32105.0,
      "step": 11900,
      "turn_loss": 0.10257967561483383,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 11703.0,
      "epoch": 0.5529176732949266,
      "grad_norm": 0.43618449568748474,
      "learning_rate": 1.7481615500691829e-09,
      "loss": 0.119,
      "mae_dtheta": 0.024711566045880318,
      "mae_dx": 0.011423442512750626,
      "mae_dy": 0.00582133186981082,
      "pose_mae_dtheta": 0.16097894310951233,
      "pose_mae_dx": 0.06839265674352646,
      "pose_mae_dy": 0.0592433400452137,
      "pose_rmse_dtheta": 0.31115010380744934,
      "pose_rmse_dx": 0.1549045741558075,
      "pose_rmse_dy": 0.15843673050403595,
      "pose_rmse_mean": 0.2081637978553772,
      "rmse_dtheta": 0.042637117207050323,
      "rmse_dx": 0.023173639550805092,
      "rmse_dy": 0.013482516631484032,
      "rmse_mean": 0.026431091129779816,
      "rotation_flip": 0.013487475924193859,
      "sparse_tokens": 9454.0,
      "step": 11901,
      "turn_loss": 0.22962740063667297,
      "turns": 36.0,
      "turns_per_sample": 36.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5529641330607694,
      "grad_norm": 0.4037160575389862,
      "learning_rate": 1.7133751222137007e-09,
      "loss": 0.0964,
      "mae_dtheta": 0.004422821570187807,
      "mae_dx": 0.0012506149942055345,
      "mae_dy": 0.0010850034886971116,
      "pose_mae_dtheta": 0.031564775854349136,
      "pose_mae_dx": 0.014376620762050152,
      "pose_mae_dy": 0.011739899404346943,
      "pose_rmse_dtheta": 0.1186964362859726,
      "pose_rmse_dx": 0.043188951909542084,
      "pose_rmse_dy": 0.03350403532385826,
      "pose_rmse_mean": 0.06512980908155441,
      "rmse_dtheta": 0.013984203338623047,
      "rmse_dx": 0.0034915150608867407,
      "rmse_dy": 0.0032711345702409744,
      "rmse_mean": 0.006915617734193802,
      "rotation_flip": 0.005190311465412378,
      "sparse_tokens": 32121.0,
      "step": 11902,
      "turn_loss": 0.04938356205821037,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 10051.0,
      "epoch": 0.5530105928266121,
      "grad_norm": 0.4165339469909668,
      "learning_rate": 1.678938227224758e-09,
      "loss": 0.1004,
      "mae_dtheta": 0.016959046944975853,
      "mae_dx": 0.0065272217616438866,
      "mae_dy": 0.002896853256970644,
      "pose_mae_dtheta": 0.1269741952419281,
      "pose_mae_dx": 0.040653251111507416,
      "pose_mae_dy": 0.050592534244060516,
      "pose_rmse_dtheta": 0.25847890973091125,
      "pose_rmse_dx": 0.11080362647771835,
      "pose_rmse_dy": 0.12643322348594666,
      "pose_rmse_mean": 0.16523858904838562,
      "rmse_dtheta": 0.0330110602080822,
      "rmse_dx": 0.016805319115519524,
      "rmse_dy": 0.006218323018401861,
      "rmse_mean": 0.01867823302745819,
      "rotation_flip": 0.008097166195511818,
      "sparse_tokens": 7957.0,
      "step": 11903,
      "turn_loss": 0.1074146181344986,
      "turns": 31.0,
      "turns_per_sample": 31.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.553057052592455,
      "grad_norm": 0.3692142069339752,
      "learning_rate": 1.644850867510428e-09,
      "loss": 0.1048,
      "mae_dtheta": 0.014676057733595371,
      "mae_dx": 0.00191426370292902,
      "mae_dy": 0.0037827729247510433,
      "pose_mae_dtheta": 0.1033240556716919,
      "pose_mae_dx": 0.029544813558459282,
      "pose_mae_dy": 0.038170408457517624,
      "pose_rmse_dtheta": 0.257275253534317,
      "pose_rmse_dx": 0.0701950192451477,
      "pose_rmse_dy": 0.08839693665504456,
      "pose_rmse_mean": 0.13862240314483643,
      "rmse_dtheta": 0.029667649418115616,
      "rmse_dx": 0.004362175241112709,
      "rmse_dy": 0.007337790448218584,
      "rmse_mean": 0.013789205811917782,
      "rotation_flip": 0.003541532438248396,
      "sparse_tokens": 32137.0,
      "step": 11904,
      "turn_loss": 0.126725435256958,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5531035123582977,
      "grad_norm": 0.5672355890274048,
      "learning_rate": 1.61111304545436e-09,
      "loss": 0.132,
      "mae_dtheta": 0.009430724196135998,
      "mae_dx": 0.001754832686856389,
      "mae_dy": 0.0026676254346966743,
      "pose_mae_dtheta": 0.05771166831254959,
      "pose_mae_dx": 0.02266773208975792,
      "pose_mae_dy": 0.027019470930099487,
      "pose_rmse_dtheta": 0.10905784368515015,
      "pose_rmse_dx": 0.055933911353349686,
      "pose_rmse_dy": 0.0557442232966423,
      "pose_rmse_mean": 0.07357865571975708,
      "rmse_dtheta": 0.018551157787442207,
      "rmse_dx": 0.005028413143008947,
      "rmse_dy": 0.0055207484401762486,
      "rmse_mean": 0.009700106456875801,
      "rotation_flip": 0.0129461158066988,
      "sparse_tokens": 32089.0,
      "step": 11905,
      "turn_loss": 0.09635552763938904,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5531499721241405,
      "grad_norm": 0.45218920707702637,
      "learning_rate": 1.5777247634163328e-09,
      "loss": 0.0865,
      "mae_dtheta": 0.0072178407572209835,
      "mae_dx": 0.0013424979988485575,
      "mae_dy": 0.0016168617876246572,
      "pose_mae_dtheta": 0.05092400684952736,
      "pose_mae_dx": 0.016125604510307312,
      "pose_mae_dy": 0.016690174117684364,
      "pose_rmse_dtheta": 0.18236061930656433,
      "pose_rmse_dx": 0.04634478688240051,
      "pose_rmse_dy": 0.03981701657176018,
      "pose_rmse_mean": 0.08950747549533844,
      "rmse_dtheta": 0.019965708255767822,
      "rmse_dx": 0.00432749604806304,
      "rmse_dy": 0.003982014022767544,
      "rmse_mean": 0.009425072930753231,
      "rotation_flip": 0.0022482015192508698,
      "sparse_tokens": 32089.0,
      "step": 11906,
      "turn_loss": 0.04855824634432793,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.5531964318899832,
      "grad_norm": 1.0133273601531982,
      "learning_rate": 1.5446860237305906e-09,
      "loss": 0.2348,
      "mae_dtheta": 0.01687885820865631,
      "mae_dx": 0.00872387271374464,
      "mae_dy": 0.0019195177592337132,
      "pose_mae_dtheta": 0.11474001407623291,
      "pose_mae_dx": 0.054857343435287476,
      "pose_mae_dy": 0.032007597386837006,
      "pose_rmse_dtheta": 0.2913418710231781,
      "pose_rmse_dx": 0.15014725923538208,
      "pose_rmse_dy": 0.07453975081443787,
      "pose_rmse_mean": 0.1720096319913864,
      "rmse_dtheta": 0.034922584891319275,
      "rmse_dx": 0.022149229422211647,
      "rmse_dy": 0.0036233272403478622,
      "rmse_mean": 0.020231714472174644,
      "rotation_flip": 0.010695187374949455,
      "sparse_tokens": 4521.0,
      "step": 11907,
      "turn_loss": 0.13265955448150635,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5532428916558261,
      "grad_norm": 0.3942638635635376,
      "learning_rate": 1.5119968287080623e-09,
      "loss": 0.0988,
      "mae_dtheta": 0.012663071043789387,
      "mae_dx": 0.0022322414442896843,
      "mae_dy": 0.00399911729618907,
      "pose_mae_dtheta": 0.07840229570865631,
      "pose_mae_dx": 0.029882149770855904,
      "pose_mae_dy": 0.03357604891061783,
      "pose_rmse_dtheta": 0.16116978228092194,
      "pose_rmse_dx": 0.08287160098552704,
      "pose_rmse_dy": 0.06748977303504944,
      "pose_rmse_mean": 0.10384371876716614,
      "rmse_dtheta": 0.022084256634116173,
      "rmse_dx": 0.006900100968778133,
      "rmse_dy": 0.0077291554771363735,
      "rmse_mean": 0.01223783753812313,
      "rotation_flip": 0.0054054055362939835,
      "sparse_tokens": 32089.0,
      "step": 11908,
      "turn_loss": 0.10579553991556168,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5532893514216688,
      "grad_norm": 0.36362653970718384,
      "learning_rate": 1.479657180634142e-09,
      "loss": 0.07,
      "mae_dtheta": 0.011657189577817917,
      "mae_dx": 0.0017276532016694546,
      "mae_dy": 0.0027037556283175945,
      "pose_mae_dtheta": 0.07771848887205124,
      "pose_mae_dx": 0.02033345215022564,
      "pose_mae_dy": 0.029367458075284958,
      "pose_rmse_dtheta": 0.2085043340921402,
      "pose_rmse_dx": 0.04874628037214279,
      "pose_rmse_dy": 0.06651369482278824,
      "pose_rmse_mean": 0.10792143642902374,
      "rmse_dtheta": 0.02707049995660782,
      "rmse_dx": 0.005233140662312508,
      "rmse_dy": 0.006448651198297739,
      "rmse_mean": 0.012917431071400642,
      "rotation_flip": 0.005841121543198824,
      "sparse_tokens": 32089.0,
      "step": 11909,
      "turn_loss": 0.10399375110864639,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5533358111875116,
      "grad_norm": 0.38368213176727295,
      "learning_rate": 1.4476670817703541e-09,
      "loss": 0.0839,
      "mae_dtheta": 0.01043422520160675,
      "mae_dx": 0.0018674153834581375,
      "mae_dy": 0.0024165422655642033,
      "pose_mae_dtheta": 0.07092151790857315,
      "pose_mae_dx": 0.01796862669289112,
      "pose_mae_dy": 0.022757459431886673,
      "pose_rmse_dtheta": 0.19543017446994781,
      "pose_rmse_dx": 0.04496781527996063,
      "pose_rmse_dy": 0.05389587953686714,
      "pose_rmse_mean": 0.09809796512126923,
      "rmse_dtheta": 0.025127161294221878,
      "rmse_dx": 0.006326117552816868,
      "rmse_dy": 0.0073916553519666195,
      "rmse_mean": 0.012948310934007168,
      "rotation_flip": 0.004907975438982248,
      "sparse_tokens": 32105.0,
      "step": 11910,
      "turn_loss": 0.08812625706195831,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5533822709533543,
      "grad_norm": 0.37475454807281494,
      "learning_rate": 1.4160265343549084e-09,
      "loss": 0.073,
      "mae_dtheta": 0.005596100352704525,
      "mae_dx": 0.0014199318829923868,
      "mae_dy": 0.0011444514384493232,
      "pose_mae_dtheta": 0.03961971402168274,
      "pose_mae_dx": 0.014852582477033138,
      "pose_mae_dy": 0.013804219663143158,
      "pose_rmse_dtheta": 0.11666764318943024,
      "pose_rmse_dx": 0.05175059288740158,
      "pose_rmse_dy": 0.038024939596652985,
      "pose_rmse_mean": 0.06881438940763474,
      "rmse_dtheta": 0.015104508027434349,
      "rmse_dx": 0.005592435132712126,
      "rmse_dy": 0.0029266446363180876,
      "rmse_mean": 0.00787452980875969,
      "rotation_flip": 0.0014312977436929941,
      "sparse_tokens": 32137.0,
      "step": 11911,
      "turn_loss": 0.03873489797115326,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20126.0,
      "epoch": 0.5534287307191972,
      "grad_norm": 0.3820381462574005,
      "learning_rate": 1.384735540598814e-09,
      "loss": 0.1004,
      "mae_dtheta": 0.01596173085272312,
      "mae_dx": 0.005599095951765776,
      "mae_dy": 0.002352271694689989,
      "pose_mae_dtheta": 0.1024564802646637,
      "pose_mae_dx": 0.0424155667424202,
      "pose_mae_dy": 0.02839970774948597,
      "pose_rmse_dtheta": 0.24324756860733032,
      "pose_rmse_dx": 0.11999394744634628,
      "pose_rmse_dy": 0.0747939795255661,
      "pose_rmse_mean": 0.1460118293762207,
      "rmse_dtheta": 0.034090556204319,
      "rmse_dx": 0.015517733059823513,
      "rmse_dy": 0.005083700176328421,
      "rmse_mean": 0.018230663612484932,
      "rotation_flip": 0.0062500000931322575,
      "sparse_tokens": 16942.0,
      "step": 11912,
      "turn_loss": 0.12635338306427002,
      "turns": 62.0,
      "turns_per_sample": 62.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5534751904850399,
      "grad_norm": 0.43652719259262085,
      "learning_rate": 1.3537941026914302e-09,
      "loss": 0.113,
      "mae_dtheta": 0.008591476827859879,
      "mae_dx": 0.0011572777293622494,
      "mae_dy": 0.001715512597002089,
      "pose_mae_dtheta": 0.05795402452349663,
      "pose_mae_dx": 0.015531427226960659,
      "pose_mae_dy": 0.024246107786893845,
      "pose_rmse_dtheta": 0.13557864725589752,
      "pose_rmse_dx": 0.0453772135078907,
      "pose_rmse_dy": 0.07226428389549255,
      "pose_rmse_mean": 0.08440671861171722,
      "rmse_dtheta": 0.018110455945134163,
      "rmse_dx": 0.0036904257722198963,
      "rmse_dy": 0.0041564395651221275,
      "rmse_mean": 0.008652440272271633,
      "rotation_flip": 0.0012422360014170408,
      "sparse_tokens": 32105.0,
      "step": 11913,
      "turn_loss": 0.07004009187221527,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 14896.0,
      "epoch": 0.5535216502508827,
      "grad_norm": 0.6268536448478699,
      "learning_rate": 1.3232022227965824e-09,
      "loss": 0.1268,
      "mae_dtheta": 0.03138583153486252,
      "mae_dx": 0.016882801428437233,
      "mae_dy": 0.0037898097652941942,
      "pose_mae_dtheta": 0.2718031406402588,
      "pose_mae_dx": 0.13335533440113068,
      "pose_mae_dy": 0.04941919445991516,
      "pose_rmse_dtheta": 0.43707647919654846,
      "pose_rmse_dx": 0.2850733697414398,
      "pose_rmse_dy": 0.10696940124034882,
      "pose_rmse_mean": 0.27637308835983276,
      "rmse_dtheta": 0.04558635875582695,
      "rmse_dx": 0.030683282762765884,
      "rmse_dy": 0.0072438777424395084,
      "rmse_mean": 0.02783784084022045,
      "rotation_flip": 0.0045045046135783195,
      "sparse_tokens": 11715.0,
      "step": 11914,
      "turn_loss": 0.2946918308734894,
      "turns": 46.0,
      "turns_per_sample": 46.0
    },
    {
      "dense_tokens": 7166.0,
      "epoch": 0.5535681100167256,
      "grad_norm": 0.5725059509277344,
      "learning_rate": 1.2929599030525597e-09,
      "loss": 0.1379,
      "mae_dtheta": 0.024437202140688896,
      "mae_dx": 0.012400990352034569,
      "mae_dy": 0.0044850572012364864,
      "pose_mae_dtheta": 0.19723401963710785,
      "pose_mae_dx": 0.09919951111078262,
      "pose_mae_dy": 0.07065238058567047,
      "pose_rmse_dtheta": 0.3480738699436188,
      "pose_rmse_dx": 0.228368878364563,
      "pose_rmse_dy": 0.15294115245342255,
      "pose_rmse_mean": 0.2431279718875885,
      "rmse_dtheta": 0.039768096059560776,
      "rmse_dx": 0.025873800739645958,
      "rmse_dy": 0.00902961753308773,
      "rmse_mean": 0.024890504777431488,
      "rotation_flip": 0.012987012974917889,
      "sparse_tokens": 5779.0,
      "step": 11915,
      "turn_loss": 0.21562384068965912,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 19802.0,
      "epoch": 0.5536145697825683,
      "grad_norm": 0.5636734962463379,
      "learning_rate": 1.2630671455748922e-09,
      "loss": 0.1528,
      "mae_dtheta": 0.03126508742570877,
      "mae_dx": 0.009960765950381756,
      "mae_dy": 0.0058792876079678535,
      "pose_mae_dtheta": 0.24034468829631805,
      "pose_mae_dx": 0.08327248692512512,
      "pose_mae_dy": 0.07267214357852936,
      "pose_rmse_dtheta": 0.4381178617477417,
      "pose_rmse_dx": 0.1848522275686264,
      "pose_rmse_dy": 0.17745579779148102,
      "pose_rmse_mean": 0.2668086290359497,
      "rmse_dtheta": 0.04987173154950142,
      "rmse_dx": 0.020324157550930977,
      "rmse_dy": 0.013601690530776978,
      "rmse_mean": 0.027932528406381607,
      "rotation_flip": 0.00792752020061016,
      "sparse_tokens": 16097.0,
      "step": 11916,
      "turn_loss": 0.2319694608449936,
      "turns": 61.0,
      "turns_per_sample": 61.0
    },
    {
      "dense_tokens": 64441.0,
      "epoch": 0.5536610295484111,
      "grad_norm": 0.4107184112071991,
      "learning_rate": 1.2335239524541298e-09,
      "loss": 0.1009,
      "mae_dtheta": 0.008727465756237507,
      "mae_dx": 0.00201417482458055,
      "mae_dy": 0.001943729119375348,
      "pose_mae_dtheta": 0.06156550720334053,
      "pose_mae_dx": 0.025111084803938866,
      "pose_mae_dy": 0.024039674550294876,
      "pose_rmse_dtheta": 0.16125142574310303,
      "pose_rmse_dx": 0.06501726806163788,
      "pose_rmse_dy": 0.06611122936010361,
      "pose_rmse_mean": 0.09745997190475464,
      "rmse_dtheta": 0.020312942564487457,
      "rmse_dx": 0.006306542549282312,
      "rmse_dy": 0.005000673234462738,
      "rmse_mean": 0.010540053248405457,
      "rotation_flip": 0.0023900573141872883,
      "sparse_tokens": 32041.0,
      "step": 11917,
      "turn_loss": 0.09336519986391068,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5537074893142538,
      "grad_norm": 0.5723971724510193,
      "learning_rate": 1.2043303257563975e-09,
      "loss": 0.1026,
      "mae_dtheta": 0.012019774876534939,
      "mae_dx": 0.003058226080611348,
      "mae_dy": 0.004535395186394453,
      "pose_mae_dtheta": 0.08062886446714401,
      "pose_mae_dx": 0.03511305898427963,
      "pose_mae_dy": 0.030732307583093643,
      "pose_rmse_dtheta": 0.190171018242836,
      "pose_rmse_dx": 0.10769402235746384,
      "pose_rmse_dy": 0.06758349388837814,
      "pose_rmse_mean": 0.12181618064641953,
      "rmse_dtheta": 0.02495659701526165,
      "rmse_dx": 0.008039546199142933,
      "rmse_dy": 0.01024517323821783,
      "rmse_mean": 0.014413773082196712,
      "rotation_flip": 0.0060910070315003395,
      "sparse_tokens": 32089.0,
      "step": 11918,
      "turn_loss": 0.10705824941396713,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 19154.0,
      "epoch": 0.5537539490800967,
      "grad_norm": 0.46645671129226685,
      "learning_rate": 1.1754862675222855e-09,
      "loss": 0.0848,
      "mae_dtheta": 0.024829350411891937,
      "mae_dx": 0.007881621830165386,
      "mae_dy": 0.002334709046408534,
      "pose_mae_dtheta": 0.16523584723472595,
      "pose_mae_dx": 0.05980125442147255,
      "pose_mae_dy": 0.02039656788110733,
      "pose_rmse_dtheta": 0.35407406091690063,
      "pose_rmse_dx": 0.16356606781482697,
      "pose_rmse_dy": 0.05360420048236847,
      "pose_rmse_mean": 0.19041477143764496,
      "rmse_dtheta": 0.04458020627498627,
      "rmse_dx": 0.018605846911668777,
      "rmse_dy": 0.0057654837146401405,
      "rmse_mean": 0.022983845323324203,
      "rotation_flip": 0.009950248524546623,
      "sparse_tokens": 15361.0,
      "step": 11919,
      "turn_loss": 0.17079870402812958,
      "turns": 59.0,
      "turns_per_sample": 59.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5538004088459394,
      "grad_norm": 0.4943907856941223,
      "learning_rate": 1.1469917797696238e-09,
      "loss": 0.094,
      "mae_dtheta": 0.010288260877132416,
      "mae_dx": 0.0016851689433678985,
      "mae_dy": 0.00198442954570055,
      "pose_mae_dtheta": 0.06399226933717728,
      "pose_mae_dx": 0.019738294184207916,
      "pose_mae_dy": 0.023180514574050903,
      "pose_rmse_dtheta": 0.18205730617046356,
      "pose_rmse_dx": 0.05217183753848076,
      "pose_rmse_dy": 0.054133351892232895,
      "pose_rmse_mean": 0.09612083435058594,
      "rmse_dtheta": 0.022560516372323036,
      "rmse_dx": 0.005400235299021006,
      "rmse_dy": 0.004231457598507404,
      "rmse_mean": 0.010730735957622528,
      "rotation_flip": 0.004123711492866278,
      "sparse_tokens": 32073.0,
      "step": 11920,
      "turn_loss": 0.0772787407040596,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.5538468686117822,
      "grad_norm": 0.4399409294128418,
      "learning_rate": 1.118846864490708e-09,
      "loss": 0.0588,
      "mae_dtheta": 0.037425447255373,
      "mae_dx": 0.007630015257745981,
      "mae_dy": 0.0045210025273263454,
      "pose_mae_dtheta": 0.3499948978424072,
      "pose_mae_dx": 0.0484791025519371,
      "pose_mae_dy": 0.08915413916110992,
      "pose_rmse_dtheta": 0.63534015417099,
      "pose_rmse_dx": 0.12298904359340668,
      "pose_rmse_dy": 0.200262650847435,
      "pose_rmse_mean": 0.3195306360721588,
      "rmse_dtheta": 0.05948852375149727,
      "rmse_dx": 0.02111983671784401,
      "rmse_dy": 0.00866987556219101,
      "rmse_mean": 0.02975941263139248,
      "rotation_flip": 0.008658008649945259,
      "sparse_tokens": 4503.0,
      "step": 11921,
      "turn_loss": 0.17996661365032196,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 14252.0,
      "epoch": 0.553893328377625,
      "grad_norm": 0.36530646681785583,
      "learning_rate": 1.0910515236545183e-09,
      "loss": 0.0779,
      "mae_dtheta": 0.03705880418419838,
      "mae_dx": 0.016646403819322586,
      "mae_dy": 0.006233794614672661,
      "pose_mae_dtheta": 0.28977152705192566,
      "pose_mae_dx": 0.1355234831571579,
      "pose_mae_dy": 0.053870681673288345,
      "pose_rmse_dtheta": 0.4729023575782776,
      "pose_rmse_dx": 0.28963717818260193,
      "pose_rmse_dy": 0.11785989999771118,
      "pose_rmse_mean": 0.2934664785861969,
      "rmse_dtheta": 0.05315157026052475,
      "rmse_dx": 0.030527815222740173,
      "rmse_dy": 0.012147956527769566,
      "rmse_mean": 0.031942449510097504,
      "rotation_flip": 0.017426272854208946,
      "sparse_tokens": 11295.0,
      "step": 11922,
      "turn_loss": 0.3172588050365448,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 22325.0,
      "epoch": 0.5539397881434678,
      "grad_norm": 0.6028034687042236,
      "learning_rate": 1.0636057592033899e-09,
      "loss": 0.0934,
      "mae_dtheta": 0.03181237727403641,
      "mae_dx": 0.01024002768099308,
      "mae_dy": 0.004971201531589031,
      "pose_mae_dtheta": 0.2548874318599701,
      "pose_mae_dx": 0.08265292644500732,
      "pose_mae_dy": 0.07422386109828949,
      "pose_rmse_dtheta": 0.4449513256549835,
      "pose_rmse_dx": 0.1754877269268036,
      "pose_rmse_dy": 0.1653125137090683,
      "pose_rmse_mean": 0.26191720366477966,
      "rmse_dtheta": 0.049290649592876434,
      "rmse_dx": 0.021448103711009026,
      "rmse_dy": 0.009185024537146091,
      "rmse_mean": 0.02664126083254814,
      "rotation_flip": 0.003964321222156286,
      "sparse_tokens": 18523.0,
      "step": 11923,
      "turn_loss": 0.22425492107868195,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5539862479093105,
      "grad_norm": 0.4948384463787079,
      "learning_rate": 1.0365095730580089e-09,
      "loss": 0.0906,
      "mae_dtheta": 0.008616026490926743,
      "mae_dx": 0.0011850068112835288,
      "mae_dy": 0.0013221092522144318,
      "pose_mae_dtheta": 0.056911125779151917,
      "pose_mae_dx": 0.014176387339830399,
      "pose_mae_dy": 0.021811917424201965,
      "pose_rmse_dtheta": 0.15473736822605133,
      "pose_rmse_dx": 0.039613280445337296,
      "pose_rmse_dy": 0.049513671547174454,
      "pose_rmse_mean": 0.08128810673952103,
      "rmse_dtheta": 0.020546332001686096,
      "rmse_dx": 0.00457709189504385,
      "rmse_dy": 0.0025321703869849443,
      "rmse_mean": 0.009218532592058182,
      "rotation_flip": 0.0036915503442287445,
      "sparse_tokens": 32089.0,
      "step": 11924,
      "turn_loss": 0.06294263154268265,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 9728.0,
      "epoch": 0.5540327076751533,
      "grad_norm": 0.615433394908905,
      "learning_rate": 1.0097629671124153e-09,
      "loss": 0.1416,
      "mae_dtheta": 0.02280617691576481,
      "mae_dx": 0.010551045648753643,
      "mae_dy": 0.0054802680388092995,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6154333353042603,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 131.5086669921875,
      "model/head/act_norm_mean": 108.46304524739584,
      "model/head/act_norm_min": 82.70438385009766,
      "model/head/act_over_embed": 74.53682014103866,
      "model/head/grad_frac": 0.10381677746772766,
      "model/head/grad_norm": 0.06389230489730835,
      "model/head/grad_zero_frac": 0.00017449946608394384,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.69755859375,
      "model/head/update_ratio": 0.0010876214364543557,
      "model/head/weight_delta": 9.986139297485352,
      "model/head/weight_delta_rel": 0.17518645524978638,
      "model/head/weight_norm": 58.7449836730957,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42286911606788635,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.42286911606788635,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42286911606788635,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.2905996155248906,
      "model/modality_embedder.encoders.pose/grad_frac": 0.05685436725616455,
      "model/modality_embedder.encoders.pose/grad_norm": 0.03499007225036621,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder.encoders.pose/update_ratio": 0.001129810349084437,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569371223449707,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.1031469777226448,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96986198425293,
      "model/modality_embedder/grad_frac": 0.05685436725616455,
      "model/modality_embedder/grad_norm": 0.03499007225036621,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.548828125,
      "model/modality_embedder/update_ratio": 0.001129810349084437,
      "model/modality_embedder/weight_delta": 3.1569371223449707,
      "model/modality_embedder/weight_delta_rel": 0.1031469777226448,
      "model/modality_embedder/weight_norm": 30.96986198425293,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 73.05686950683594,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.408254794973544,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.299155235290527,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.08637184664,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07220659404993057,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.04443834722042084,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0015892816008999944,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.742943525314331,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.0999545156955719,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961278915405273,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 74.19788360595703,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 24.176060267857142,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.752635955810547,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.6140149559137,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.07328490912914276,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.04510197415947914,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019165591220371425,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.001514964271336794,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.4777121543884277,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12047066539525986,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77098274230957,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 75.62643432617188,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.73755787037037,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.949736595153809,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.687090727331668,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.076151542365551,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.046866197139024734,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0002067866298602894,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0015244721435010433,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.76772141456604,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1265130341053009,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742572784423828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 76.16129302978516,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.61248553240741,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.604537010192871,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.975558570032852,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06908124685287476,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.042514901608228683,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0014192542294040322,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.238784074783325,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1106862723827362,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9558048248291,
      "model/normalizer/grad_frac": 0.27953290939331055,
      "model/normalizer/grad_norm": 0.1720338761806488,
      "model/normalizer/grad_zero_frac": 0.00021271291188895702,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.002187107689678669,
      "model/normalizer/weight_delta": 6.81096076965332,
      "model/normalizer/weight_delta_rel": 0.08772122859954834,
      "model/normalizer/weight_norm": 78.65816497802734,
      "pose_mae_dtheta": 0.1643228381872177,
      "pose_mae_dx": 0.059223126620054245,
      "pose_mae_dy": 0.07645399123430252,
      "pose_rmse_dtheta": 0.2917023003101349,
      "pose_rmse_dx": 0.13723032176494598,
      "pose_rmse_dy": 0.1861693114042282,
      "pose_rmse_mean": 0.20503398776054382,
      "rmse_dtheta": 0.03438768908381462,
      "rmse_dx": 0.0231823418289423,
      "rmse_dy": 0.009839977137744427,
      "rmse_mean": 0.022470002993941307,
      "rotation_flip": 0.03102625347673893,
      "sparse_tokens": 8257.0,
      "step": 11925,
      "turn_loss": 0.19869008660316467,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5540791674409961,
      "grad_norm": 0.49800240993499756,
      "learning_rate": 9.833659432367803e-10,
      "loss": 0.1159,
      "mae_dtheta": 0.005925173871219158,
      "mae_dx": 0.001262929872609675,
      "mae_dy": 0.0009823053842410445,
      "pose_mae_dtheta": 0.0375942662358284,
      "pose_mae_dx": 0.012199642136693,
      "pose_mae_dy": 0.010850622318685055,
      "pose_rmse_dtheta": 0.14339472353458405,
      "pose_rmse_dx": 0.032315727323293686,
      "pose_rmse_dy": 0.030484749004244804,
      "pose_rmse_mean": 0.06873174011707306,
      "rmse_dtheta": 0.020367447286844254,
      "rmse_dx": 0.0039007675368338823,
      "rmse_dy": 0.002763440366834402,
      "rmse_mean": 0.009010552428662777,
      "rotation_flip": 0.002795899286866188,
      "sparse_tokens": 32169.0,
      "step": 11926,
      "turn_loss": 0.052168555557727814,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5541256272068389,
      "grad_norm": 0.38386860489845276,
      "learning_rate": 9.573185032779597e-10,
      "loss": 0.0815,
      "mae_dtheta": 0.009678179398179054,
      "mae_dx": 0.0010104794055223465,
      "mae_dy": 0.0008640137384645641,
      "pose_mae_dtheta": 0.06705891340970993,
      "pose_mae_dx": 0.00915081799030304,
      "pose_mae_dy": 0.009296546690165997,
      "pose_rmse_dtheta": 0.2771282196044922,
      "pose_rmse_dx": 0.021533872932195663,
      "pose_rmse_dy": 0.027848336845636368,
      "pose_rmse_mean": 0.1088368147611618,
      "rmse_dtheta": 0.03255574405193329,
      "rmse_dx": 0.002922244369983673,
      "rmse_dy": 0.003238511271774769,
      "rmse_mean": 0.012905499897897243,
      "rotation_flip": 0.0005081300623714924,
      "sparse_tokens": 32169.0,
      "step": 11927,
      "turn_loss": 0.04934220388531685,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.5541720869726816,
      "grad_norm": 1.0679585933685303,
      "learning_rate": 9.316206490572744e-10,
      "loss": 0.2819,
      "mae_dtheta": 0.036929354071617126,
      "mae_dx": 0.013857822865247726,
      "mae_dy": 0.005661604925990105,
      "pose_mae_dtheta": 0.30195140838623047,
      "pose_mae_dx": 0.13490626215934753,
      "pose_mae_dy": 0.05932052433490753,
      "pose_rmse_dtheta": 0.49772799015045166,
      "pose_rmse_dx": 0.24592724442481995,
      "pose_rmse_dy": 0.13055656850337982,
      "pose_rmse_mean": 0.29140394926071167,
      "rmse_dtheta": 0.05271638557314873,
      "rmse_dx": 0.025246314704418182,
      "rmse_dy": 0.010251127183437347,
      "rmse_mean": 0.02940460853278637,
      "rotation_flip": 0.0052083334885537624,
      "sparse_tokens": 10439.0,
      "step": 11928,
      "turn_loss": 0.35989704728126526,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 17803.0,
      "epoch": 0.5542185467385244,
      "grad_norm": 0.6174960136413574,
      "learning_rate": 9.062723823710651e-10,
      "loss": 0.1278,
      "mae_dtheta": 0.025684596970677376,
      "mae_dx": 0.010178646072745323,
      "mae_dy": 0.004473683424293995,
      "pose_mae_dtheta": 0.19832900166511536,
      "pose_mae_dx": 0.07666971534490585,
      "pose_mae_dy": 0.052434291690588,
      "pose_rmse_dtheta": 0.3666938245296478,
      "pose_rmse_dx": 0.16905181109905243,
      "pose_rmse_dy": 0.13826557993888855,
      "pose_rmse_mean": 0.22467041015625,
      "rmse_dtheta": 0.04029751569032669,
      "rmse_dx": 0.021077783778309822,
      "rmse_dy": 0.009754350408911705,
      "rmse_mean": 0.02370988391339779,
      "rotation_flip": 0.010588235221803188,
      "sparse_tokens": 13388.0,
      "step": 11929,
      "turn_loss": 0.22170788049697876,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5542650065043672,
      "grad_norm": 0.5443359613418579,
      "learning_rate": 8.812737049929132e-10,
      "loss": 0.1407,
      "mae_dtheta": 0.012060180306434631,
      "mae_dx": 0.0026153612416237593,
      "mae_dy": 0.003975513856858015,
      "pose_mae_dtheta": 0.08390624821186066,
      "pose_mae_dx": 0.032074522227048874,
      "pose_mae_dy": 0.03561616316437721,
      "pose_rmse_dtheta": 0.1993657797574997,
      "pose_rmse_dx": 0.10382167994976044,
      "pose_rmse_dy": 0.0750700980424881,
      "pose_rmse_mean": 0.12608586251735687,
      "rmse_dtheta": 0.024075208231806755,
      "rmse_dx": 0.007672672625631094,
      "rmse_dy": 0.00936969742178917,
      "rmse_mean": 0.013705859892070293,
      "rotation_flip": 0.01071203500032425,
      "sparse_tokens": 32121.0,
      "step": 11930,
      "turn_loss": 0.12325789779424667,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7467.0,
      "epoch": 0.55431146627021,
      "grad_norm": 1.0420814752578735,
      "learning_rate": 8.566246186697547e-10,
      "loss": 0.236,
      "mae_dtheta": 0.02039969712495804,
      "mae_dx": 0.008052229881286621,
      "mae_dy": 0.003152121091261506,
      "pose_mae_dtheta": 0.15159164369106293,
      "pose_mae_dx": 0.060146987438201904,
      "pose_mae_dy": 0.047282759100198746,
      "pose_rmse_dtheta": 0.26783204078674316,
      "pose_rmse_dx": 0.13259591162204742,
      "pose_rmse_dy": 0.12010269612073898,
      "pose_rmse_mean": 0.17351022362709045,
      "rmse_dtheta": 0.036666180938482285,
      "rmse_dx": 0.01819717139005661,
      "rmse_dy": 0.005843129940330982,
      "rmse_mean": 0.020235493779182434,
      "rotation_flip": 0.009554140269756317,
      "sparse_tokens": 5892.0,
      "step": 11931,
      "turn_loss": 0.20005474984645844,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5543579260360528,
      "grad_norm": 0.4505561888217926,
      "learning_rate": 8.323251251263209e-10,
      "loss": 0.1227,
      "mae_dtheta": 0.009197253733873367,
      "mae_dx": 0.0014151784125715494,
      "mae_dy": 0.0024415827356278896,
      "pose_mae_dtheta": 0.057960838079452515,
      "pose_mae_dx": 0.02101806364953518,
      "pose_mae_dy": 0.026800738647580147,
      "pose_rmse_dtheta": 0.13539955019950867,
      "pose_rmse_dx": 0.058941666036844254,
      "pose_rmse_dy": 0.0693899393081665,
      "pose_rmse_mean": 0.08791038393974304,
      "rmse_dtheta": 0.019555898383259773,
      "rmse_dx": 0.004718939308077097,
      "rmse_dy": 0.005451513919979334,
      "rmse_mean": 0.009908784180879593,
      "rotation_flip": 0.003524850122630596,
      "sparse_tokens": 32105.0,
      "step": 11932,
      "turn_loss": 0.07479358464479446,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5544043858018955,
      "grad_norm": 0.6002763509750366,
      "learning_rate": 8.083752260618083e-10,
      "loss": 0.1408,
      "mae_dtheta": 0.01088019460439682,
      "mae_dx": 0.0026720447931438684,
      "mae_dy": 0.001511743408627808,
      "pose_mae_dtheta": 0.07839293032884598,
      "pose_mae_dx": 0.022638551890850067,
      "pose_mae_dy": 0.021176084876060486,
      "pose_rmse_dtheta": 0.2633243501186371,
      "pose_rmse_dx": 0.08037871867418289,
      "pose_rmse_dy": 0.06340845674276352,
      "pose_rmse_mean": 0.13570384681224823,
      "rmse_dtheta": 0.03084207884967327,
      "rmse_dx": 0.009704619646072388,
      "rmse_dy": 0.004820283502340317,
      "rmse_mean": 0.015122327953577042,
      "rotation_flip": 0.004331347998231649,
      "sparse_tokens": 32105.0,
      "step": 11933,
      "turn_loss": 0.09819115698337555,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 4901.0,
      "epoch": 0.5544508455677384,
      "grad_norm": 1.0001096725463867,
      "learning_rate": 7.847749231509883e-10,
      "loss": 0.2344,
      "mae_dtheta": 0.035494010895490646,
      "mae_dx": 0.01860213279724121,
      "mae_dy": 0.0054015167988836765,
      "pose_mae_dtheta": 0.29986807703971863,
      "pose_mae_dx": 0.10287656635046005,
      "pose_mae_dy": 0.07162699848413467,
      "pose_rmse_dtheta": 0.50416100025177,
      "pose_rmse_dx": 0.21912319958209991,
      "pose_rmse_dy": 0.18027715384960175,
      "pose_rmse_mean": 0.301187127828598,
      "rmse_dtheta": 0.0531248115003109,
      "rmse_dx": 0.032378390431404114,
      "rmse_dy": 0.009905362501740456,
      "rmse_mean": 0.03180285543203354,
      "rotation_flip": 0.0,
      "sparse_tokens": 4007.0,
      "step": 11934,
      "turn_loss": 0.2216835916042328,
      "turns": 15.0,
      "turns_per_sample": 15.0
    },
    {
      "dense_tokens": 33634.0,
      "epoch": 0.5544973053335811,
      "grad_norm": 0.7168287038803101,
      "learning_rate": 7.615242180436521e-10,
      "loss": 0.1829,
      "mae_dtheta": 0.0411495603621006,
      "mae_dx": 0.016617700457572937,
      "mae_dy": 0.008040035143494606,
      "pose_mae_dtheta": 0.3389190435409546,
      "pose_mae_dx": 0.12450872361660004,
      "pose_mae_dy": 0.08516813069581985,
      "pose_rmse_dtheta": 0.5598798990249634,
      "pose_rmse_dx": 0.2655094265937805,
      "pose_rmse_dy": 0.18473969399929047,
      "pose_rmse_mean": 0.3367096781730652,
      "rmse_dtheta": 0.05851740762591362,
      "rmse_dx": 0.03026081807911396,
      "rmse_dy": 0.016300389543175697,
      "rmse_mean": 0.03502620756626129,
      "rotation_flip": 0.01874244213104248,
      "sparse_tokens": 27428.0,
      "step": 11935,
      "turn_loss": 0.3659282922744751,
      "turns": 104.0,
      "turns_per_sample": 104.0
    },
    {
      "dense_tokens": 5870.0,
      "epoch": 0.5545437650994239,
      "grad_norm": 0.8228766918182373,
      "learning_rate": 7.386231123668319e-10,
      "loss": 0.1419,
      "mae_dtheta": 0.016535457223653793,
      "mae_dx": 0.005124552641063929,
      "mae_dy": 0.0028752207290381193,
      "pose_mae_dtheta": 0.13928842544555664,
      "pose_mae_dx": 0.0506766177713871,
      "pose_mae_dy": 0.04099171608686447,
      "pose_rmse_dtheta": 0.27164313197135925,
      "pose_rmse_dx": 0.13117623329162598,
      "pose_rmse_dy": 0.12579300999641418,
      "pose_rmse_mean": 0.1762041300535202,
      "rmse_dtheta": 0.031644947826862335,
      "rmse_dx": 0.013307642191648483,
      "rmse_dy": 0.006539033260196447,
      "rmse_mean": 0.017163874581456184,
      "rotation_flip": 0.0051282052882015705,
      "sparse_tokens": 4667.0,
      "step": 11936,
      "turn_loss": 0.10887408256530762,
      "turns": 18.0,
      "turns_per_sample": 18.0
    },
    {
      "dense_tokens": 7790.0,
      "epoch": 0.5545902248652667,
      "grad_norm": 0.408336877822876,
      "learning_rate": 7.16071607720914e-10,
      "loss": 0.0664,
      "mae_dtheta": 0.022222647443413734,
      "mae_dx": 0.01590779423713684,
      "mae_dy": 0.0069991713389754295,
      "pose_mae_dtheta": 0.16781747341156006,
      "pose_mae_dx": 0.10796398669481277,
      "pose_mae_dy": 0.08637918531894684,
      "pose_rmse_dtheta": 0.3052750527858734,
      "pose_rmse_dx": 0.22761861979961395,
      "pose_rmse_dy": 0.18304184079170227,
      "pose_rmse_mean": 0.23864516615867615,
      "rmse_dtheta": 0.037868648767471313,
      "rmse_dx": 0.028559720143675804,
      "rmse_dy": 0.011967259459197521,
      "rmse_mean": 0.026131875813007355,
      "rotation_flip": 0.009146341122686863,
      "sparse_tokens": 6727.0,
      "step": 11937,
      "turn_loss": 0.22431136667728424,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 21746.0,
      "epoch": 0.5546366846311095,
      "grad_norm": 0.4853430986404419,
      "learning_rate": 6.938697056829702e-10,
      "loss": 0.1374,
      "mae_dtheta": 0.0383651927113533,
      "mae_dx": 0.007586387917399406,
      "mae_dy": 0.004461420699954033,
      "pose_mae_dtheta": 0.30585765838623047,
      "pose_mae_dx": 0.06494788080453873,
      "pose_mae_dy": 0.0408165417611599,
      "pose_rmse_dtheta": 0.5169531106948853,
      "pose_rmse_dx": 0.14238779246807098,
      "pose_rmse_dy": 0.1055598184466362,
      "pose_rmse_mean": 0.2549669146537781,
      "rmse_dtheta": 0.05559137836098671,
      "rmse_dx": 0.016158169135451317,
      "rmse_dy": 0.010015302337706089,
      "rmse_mean": 0.027254950255155563,
      "rotation_flip": 0.01163918524980545,
      "sparse_tokens": 16739.0,
      "step": 11938,
      "turn_loss": 0.31026268005371094,
      "turns": 67.0,
      "turns_per_sample": 67.0
    },
    {
      "dense_tokens": 6842.0,
      "epoch": 0.5546831443969522,
      "grad_norm": 0.6816995143890381,
      "learning_rate": 6.720174078067577e-10,
      "loss": 0.1313,
      "mae_dtheta": 0.03279980644583702,
      "mae_dx": 0.005139852873980999,
      "mae_dy": 0.0046211532317101955,
      "pose_mae_dtheta": 0.2303323745727539,
      "pose_mae_dx": 0.0407988578081131,
      "pose_mae_dy": 0.0452473945915699,
      "pose_rmse_dtheta": 0.4738559424877167,
      "pose_rmse_dx": 0.12440366297960281,
      "pose_rmse_dy": 0.11946557462215424,
      "pose_rmse_mean": 0.23924174904823303,
      "rmse_dtheta": 0.05401154235005379,
      "rmse_dx": 0.014599982649087906,
      "rmse_dy": 0.00887445267289877,
      "rmse_mean": 0.025828659534454346,
      "rotation_flip": 0.010033444501459599,
      "sparse_tokens": 5900.0,
      "step": 11939,
      "turn_loss": 0.20754405856132507,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 6821.0,
      "epoch": 0.554729604162795,
      "grad_norm": 0.7433246970176697,
      "learning_rate": 6.505147156193881e-10,
      "loss": 0.2496,
      "mae_dtheta": 0.050365690141916275,
      "mae_dx": 0.014910787343978882,
      "mae_dy": 0.0034317371901124716,
      "pose_mae_dtheta": 0.4435909390449524,
      "pose_mae_dx": 0.11300408840179443,
      "pose_mae_dy": 0.03998894989490509,
      "pose_rmse_dtheta": 0.703414797782898,
      "pose_rmse_dx": 0.2557944655418396,
      "pose_rmse_dy": 0.08944159746170044,
      "pose_rmse_mean": 0.3495503067970276,
      "rmse_dtheta": 0.0712018609046936,
      "rmse_dx": 0.028091909363865852,
      "rmse_dy": 0.006424235180020332,
      "rmse_mean": 0.035239335149526596,
      "rotation_flip": 0.025889968499541283,
      "sparse_tokens": 5101.0,
      "step": 11940,
      "turn_loss": 0.311328262090683,
      "turns": 21.0,
      "turns_per_sample": 21.0
    },
    {
      "dense_tokens": 10406.0,
      "epoch": 0.5547760639286378,
      "grad_norm": 0.6297890543937683,
      "learning_rate": 6.293616306246586e-10,
      "loss": 0.1158,
      "mae_dtheta": 0.024513062089681625,
      "mae_dx": 0.008921731263399124,
      "mae_dy": 0.004581822548061609,
      "pose_mae_dtheta": 0.17613475024700165,
      "pose_mae_dx": 0.06390192359685898,
      "pose_mae_dy": 0.056467294692993164,
      "pose_rmse_dtheta": 0.3574877381324768,
      "pose_rmse_dx": 0.1865762323141098,
      "pose_rmse_dy": 0.127036914229393,
      "pose_rmse_mean": 0.22370031476020813,
      "rmse_dtheta": 0.03992578387260437,
      "rmse_dx": 0.02105211466550827,
      "rmse_dy": 0.009550271555781364,
      "rmse_mean": 0.023509390652179718,
      "rotation_flip": 0.009671179577708244,
      "sparse_tokens": 8758.0,
      "step": 11941,
      "turn_loss": 0.24541547894477844,
      "turns": 32.0,
      "turns_per_sample": 32.0
    },
    {
      "dense_tokens": 64601.0,
      "epoch": 0.5548225236944806,
      "grad_norm": 0.4235868453979492,
      "learning_rate": 6.085581543024966e-10,
      "loss": 0.0909,
      "mae_dtheta": 0.007286617998033762,
      "mae_dx": 0.001134209567680955,
      "mae_dy": 0.001400685403496027,
      "pose_mae_dtheta": 0.04899005964398384,
      "pose_mae_dx": 0.013027039356529713,
      "pose_mae_dy": 0.01729774847626686,
      "pose_rmse_dtheta": 0.1405380368232727,
      "pose_rmse_dx": 0.03226172924041748,
      "pose_rmse_dy": 0.043906547129154205,
      "pose_rmse_mean": 0.07223543524742126,
      "rmse_dtheta": 0.018919335678219795,
      "rmse_dx": 0.003006870625540614,
      "rmse_dy": 0.00346555607393384,
      "rmse_mean": 0.008463921025395393,
      "rotation_flip": 0.0017705382779240608,
      "sparse_tokens": 32201.0,
      "step": 11942,
      "turn_loss": 0.05235389247536659,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5548689834603233,
      "grad_norm": 0.3903115689754486,
      "learning_rate": 5.881042881067389e-10,
      "loss": 0.0954,
      "mae_dtheta": 0.011410539038479328,
      "mae_dx": 0.0019683053251355886,
      "mae_dy": 0.002968098968267441,
      "pose_mae_dtheta": 0.07832527905702591,
      "pose_mae_dx": 0.025136521086096764,
      "pose_mae_dy": 0.030061712488532066,
      "pose_rmse_dtheta": 0.19865959882736206,
      "pose_rmse_dx": 0.07016763836145401,
      "pose_rmse_dy": 0.06941315531730652,
      "pose_rmse_mean": 0.11274679750204086,
      "rmse_dtheta": 0.024524975568056107,
      "rmse_dx": 0.0061555043794214725,
      "rmse_dy": 0.006753255147486925,
      "rmse_mean": 0.01247791200876236,
      "rotation_flip": 0.0024937656708061695,
      "sparse_tokens": 32121.0,
      "step": 11943,
      "turn_loss": 0.09312722831964493,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 25232.0,
      "epoch": 0.5549154432261661,
      "grad_norm": 0.7210909724235535,
      "learning_rate": 5.680000334684633e-10,
      "loss": 0.1908,
      "mae_dtheta": 0.04500805214047432,
      "mae_dx": 0.008087036199867725,
      "mae_dy": 0.004112685099244118,
      "pose_mae_dtheta": 0.3540884256362915,
      "pose_mae_dx": 0.06953662633895874,
      "pose_mae_dy": 0.04629943147301674,
      "pose_rmse_dtheta": 0.6039813160896301,
      "pose_rmse_dx": 0.18143822252750397,
      "pose_rmse_dy": 0.1807248741388321,
      "pose_rmse_mean": 0.3220481276512146,
      "rmse_dtheta": 0.06513722240924835,
      "rmse_dx": 0.018534868955612183,
      "rmse_dy": 0.012762129306793213,
      "rmse_mean": 0.03214474022388458,
      "rotation_flip": 0.01294219121336937,
      "sparse_tokens": 18767.0,
      "step": 11944,
      "turn_loss": 0.3394859731197357,
      "turns": 78.0,
      "turns_per_sample": 78.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5549619029920089,
      "grad_norm": 0.439374178647995,
      "learning_rate": 5.482453917932117e-10,
      "loss": 0.0898,
      "mae_dtheta": 0.00902506709098816,
      "mae_dx": 0.0021654118318110704,
      "mae_dy": 0.0033307657577097416,
      "pose_mae_dtheta": 0.05655122548341751,
      "pose_mae_dx": 0.026697322726249695,
      "pose_mae_dy": 0.026100866496562958,
      "pose_rmse_dtheta": 0.13057434558868408,
      "pose_rmse_dx": 0.07175473868846893,
      "pose_rmse_dy": 0.05611918494105339,
      "pose_rmse_mean": 0.0861494243144989,
      "rmse_dtheta": 0.01854884997010231,
      "rmse_dx": 0.005671040620654821,
      "rmse_dy": 0.00807080790400505,
      "rmse_mean": 0.010763566009700298,
      "rotation_flip": 0.005332385189831257,
      "sparse_tokens": 32089.0,
      "step": 11945,
      "turn_loss": 0.09360092133283615,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5550083627578517,
      "grad_norm": 0.3466114401817322,
      "learning_rate": 5.288403644626571e-10,
      "loss": 0.0932,
      "mae_dtheta": 0.007342083379626274,
      "mae_dx": 0.0015032076044008136,
      "mae_dy": 0.0017555237282067537,
      "pose_mae_dtheta": 0.045286886394023895,
      "pose_mae_dx": 0.01655603013932705,
      "pose_mae_dy": 0.019627928733825684,
      "pose_rmse_dtheta": 0.1029563844203949,
      "pose_rmse_dx": 0.04552972689270973,
      "pose_rmse_dy": 0.04610978066921234,
      "pose_rmse_mean": 0.06486529856920242,
      "rmse_dtheta": 0.01650773175060749,
      "rmse_dx": 0.005475142039358616,
      "rmse_dy": 0.003990864381194115,
      "rmse_mean": 0.008657913655042648,
      "rotation_flip": 0.0036150021478533745,
      "sparse_tokens": 32089.0,
      "step": 11946,
      "turn_loss": 0.06249779090285301,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5550548225236945,
      "grad_norm": 0.511532723903656,
      "learning_rate": 5.09784952833492e-10,
      "loss": 0.0978,
      "mae_dtheta": 0.010498570278286934,
      "mae_dx": 0.001765477005392313,
      "mae_dy": 0.0035057472996413708,
      "pose_mae_dtheta": 0.06895316392183304,
      "pose_mae_dx": 0.031133409589529037,
      "pose_mae_dy": 0.035195980221033096,
      "pose_rmse_dtheta": 0.14906907081604004,
      "pose_rmse_dx": 0.08727392554283142,
      "pose_rmse_dy": 0.07826869189739227,
      "pose_rmse_mean": 0.10487055778503418,
      "rmse_dtheta": 0.020686505362391472,
      "rmse_dx": 0.004775634966790676,
      "rmse_dy": 0.0073556755669415,
      "rmse_mean": 0.010939272120594978,
      "rotation_flip": 0.006676557939499617,
      "sparse_tokens": 32057.0,
      "step": 11947,
      "turn_loss": 0.08201391994953156,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5551012822895373,
      "grad_norm": 0.3204460144042969,
      "learning_rate": 4.910791582385388e-10,
      "loss": 0.0807,
      "mae_dtheta": 0.015489174984395504,
      "mae_dx": 0.004372320603579283,
      "mae_dy": 0.003310115309432149,
      "pose_mae_dtheta": 0.11297125369310379,
      "pose_mae_dx": 0.04008638486266136,
      "pose_mae_dy": 0.038545094430446625,
      "pose_rmse_dtheta": 0.2682693898677826,
      "pose_rmse_dx": 0.12251092493534088,
      "pose_rmse_dy": 0.09222300350666046,
      "pose_rmse_mean": 0.16100111603736877,
      "rmse_dtheta": 0.03243212401866913,
      "rmse_dx": 0.014193565584719181,
      "rmse_dy": 0.008358050137758255,
      "rmse_mean": 0.01832791417837143,
      "rotation_flip": 0.0077720205299556255,
      "sparse_tokens": 32089.0,
      "step": 11948,
      "turn_loss": 0.15939700603485107,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.5551477420553801,
      "grad_norm": 0.5453979969024658,
      "learning_rate": 4.727229819856405e-10,
      "loss": 0.0934,
      "mae_dtheta": 0.019583720713853836,
      "mae_dx": 0.009865138679742813,
      "mae_dy": 0.0036493942607194185,
      "pose_mae_dtheta": 0.12277504056692123,
      "pose_mae_dx": 0.0760221779346466,
      "pose_mae_dy": 0.050260890275239944,
      "pose_rmse_dtheta": 0.22146110236644745,
      "pose_rmse_dx": 0.18652160465717316,
      "pose_rmse_dy": 0.114871084690094,
      "pose_rmse_mean": 0.17428460717201233,
      "rmse_dtheta": 0.03322107344865799,
      "rmse_dx": 0.022853659465909004,
      "rmse_dy": 0.007591883186250925,
      "rmse_mean": 0.021222203969955444,
      "rotation_flip": 0.01600000075995922,
      "sparse_tokens": 6011.0,
      "step": 11949,
      "turn_loss": 0.14136016368865967,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5551942018212228,
      "grad_norm": 0.6735348105430603,
      "learning_rate": 4.547164253587699e-10,
      "loss": 0.1915,
      "mae_dtheta": 0.007878689095377922,
      "mae_dx": 0.0011207235511392355,
      "mae_dy": 0.0016753188101574779,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.6735348701477051,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 156.8087158203125,
      "model/head/act_norm_mean": 116.5796539614899,
      "model/head/act_norm_min": 69.34058380126953,
      "model/head/act_over_embed": 80.1146296382521,
      "model/head/grad_frac": 0.10833509266376495,
      "model/head/grad_norm": 0.07296746224164963,
      "model/head/grad_zero_frac": 0.00018782488768920302,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.7086687184343434,
      "model/head/update_ratio": 0.001242105383425951,
      "model/head/weight_delta": 9.986140251159668,
      "model/head/weight_delta_rel": 0.17518648505210876,
      "model/head/weight_norm": 58.7449836730957,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42292946577072144,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228687890514529,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.4228098392486572,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.290599390796136,
      "model/modality_embedder.encoders.pose/grad_frac": 0.06341912597417831,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04271499067544937,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5258678591628959,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013792437966912985,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569366455078125,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314696282148361,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96986198425293,
      "model/modality_embedder/grad_frac": 0.06341912597417831,
      "model/modality_embedder/grad_norm": 0.04271499067544937,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5258678591628959,
      "model/modality_embedder/update_ratio": 0.0013792437966912985,
      "model/modality_embedder/weight_delta": 3.1569366455078125,
      "model/modality_embedder/weight_delta_rel": 0.10314696282148361,
      "model/modality_embedder/weight_norm": 30.96986198425293,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 92.15176391601562,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 24.218514510181176,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.107797622680664,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 16.643189908701654,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.07866198569536209,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.05298159271478653,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.0002572223893366754,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.001894820132292807,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7429442405700684,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995454549789429,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961278915405273,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 93.9468002319336,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 25.185428190636525,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.418581008911133,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 17.307662042299068,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.08708292245864868,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.05865338444709778,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.00019669948960654438,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0019701526034623384,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.477712869644165,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12047069519758224,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.770984649658203,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 95.66414642333984,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 26.938482042648708,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 12.561594009399414,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 18.512377061750584,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.08990971744060516,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.060557328164577484,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.0001361765607725829,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.001969819888472557,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7677226066589355,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1265130639076233,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742572784423828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 96.30241394042969,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 28.608939093314092,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.182172775268555,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 19.660330786033143,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.0926070362329483,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.06237407028675079,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00018661233480088413,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.002082203049212694,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2387845516204834,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1106862872838974,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9558048248291,
      "model/normalizer/grad_frac": 0.37736454606056213,
      "model/normalizer/grad_norm": 0.25416818261146545,
      "model/normalizer/grad_zero_frac": 0.00019380509911570698,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.003231300739571452,
      "model/normalizer/weight_delta": 6.810962677001953,
      "model/normalizer/weight_delta_rel": 0.08772125840187073,
      "model/normalizer/weight_norm": 78.65816497802734,
      "pose_mae_dtheta": 0.050986114889383316,
      "pose_mae_dx": 0.011830119416117668,
      "pose_mae_dy": 0.0201070886105299,
      "pose_rmse_dtheta": 0.13784250617027283,
      "pose_rmse_dx": 0.031231170520186424,
      "pose_rmse_dy": 0.04830939695239067,
      "pose_rmse_mean": 0.07246102392673492,
      "rmse_dtheta": 0.019213441759347916,
      "rmse_dx": 0.0035256731789559126,
      "rmse_dy": 0.004593408666551113,
      "rmse_mean": 0.00911084096878767,
      "rotation_flip": 0.007246376946568489,
      "sparse_tokens": 32089.0,
      "step": 11950,
      "turn_loss": 0.06006743386387825,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17858.0,
      "epoch": 0.5552406615870656,
      "grad_norm": 0.3800334930419922,
      "learning_rate": 4.3705948961692003e-10,
      "loss": 0.1166,
      "mae_dtheta": 0.030920645222067833,
      "mae_dx": 0.00860457681119442,
      "mae_dy": 0.004801237490028143,
      "pose_mae_dtheta": 0.24795792996883392,
      "pose_mae_dx": 0.07309605926275253,
      "pose_mae_dy": 0.0431351512670517,
      "pose_rmse_dtheta": 0.47817477583885193,
      "pose_rmse_dx": 0.16975325345993042,
      "pose_rmse_dy": 0.10976197570562363,
      "pose_rmse_mean": 0.25256332755088806,
      "rmse_dtheta": 0.05229778215289116,
      "rmse_dx": 0.018546301871538162,
      "rmse_dy": 0.01204830501228571,
      "rmse_mean": 0.027630796656012535,
      "rotation_flip": 0.007398273795843124,
      "sparse_tokens": 15173.0,
      "step": 11951,
      "turn_loss": 0.28542405366897583,
      "turns": 55.0,
      "turns_per_sample": 55.0
    },
    {
      "dense_tokens": 27817.0,
      "epoch": 0.5552871213529084,
      "grad_norm": 0.46575790643692017,
      "learning_rate": 4.197521759952139e-10,
      "loss": 0.117,
      "mae_dtheta": 0.03786780685186386,
      "mae_dx": 0.010490142740309238,
      "mae_dy": 0.004915905650705099,
      "pose_mae_dtheta": 0.28938668966293335,
      "pose_mae_dx": 0.07664649188518524,
      "pose_mae_dy": 0.047862712293863297,
      "pose_rmse_dtheta": 0.4782532751560211,
      "pose_rmse_dx": 0.17420580983161926,
      "pose_rmse_dy": 0.12312056124210358,
      "pose_rmse_mean": 0.2585265636444092,
      "rmse_dtheta": 0.05403093621134758,
      "rmse_dx": 0.020828425884246826,
      "rmse_dy": 0.01212835032492876,
      "rmse_mean": 0.028995906934142113,
      "rotation_flip": 0.015328466892242432,
      "sparse_tokens": 22812.0,
      "step": 11952,
      "turn_loss": 0.3521961271762848,
      "turns": 86.0,
      "turns_per_sample": 86.0
    },
    {
      "dense_tokens": 8138.0,
      "epoch": 0.5553335811187512,
      "grad_norm": 0.6272154450416565,
      "learning_rate": 4.027944857032395e-10,
      "loss": 0.1098,
      "mae_dtheta": 0.03461022302508354,
      "mae_dx": 0.014069941826164722,
      "mae_dy": 0.002774397609755397,
      "pose_mae_dtheta": 0.2802967131137848,
      "pose_mae_dx": 0.10380792617797852,
      "pose_mae_dy": 0.032975755631923676,
      "pose_rmse_dtheta": 0.43873247504234314,
      "pose_rmse_dx": 0.23968233168125153,
      "pose_rmse_dy": 0.06589128822088242,
      "pose_rmse_mean": 0.24810203909873962,
      "rmse_dtheta": 0.05020944029092789,
      "rmse_dx": 0.028523819521069527,
      "rmse_dy": 0.005426696967333555,
      "rmse_mean": 0.028053319081664085,
      "rotation_flip": 0.009999999776482582,
      "sparse_tokens": 6620.0,
      "step": 11953,
      "turn_loss": 0.26061317324638367,
      "turns": 25.0,
      "turns_per_sample": 25.0
    },
    {
      "dense_tokens": 14250.0,
      "epoch": 0.5553800408845939,
      "grad_norm": 0.580551028251648,
      "learning_rate": 3.8618641992782535e-10,
      "loss": 0.1317,
      "mae_dtheta": 0.03740967810153961,
      "mae_dx": 0.00832141749560833,
      "mae_dy": 0.004592105280607939,
      "pose_mae_dtheta": 0.30765944719314575,
      "pose_mae_dx": 0.0782017931342125,
      "pose_mae_dy": 0.059241171926259995,
      "pose_rmse_dtheta": 0.573445200920105,
      "pose_rmse_dx": 0.18791761994361877,
      "pose_rmse_dy": 0.14998012781143188,
      "pose_rmse_mean": 0.3037809729576111,
      "rmse_dtheta": 0.05842216685414314,
      "rmse_dx": 0.01843186840415001,
      "rmse_dy": 0.00950086209923029,
      "rmse_mean": 0.028784966096282005,
      "rotation_flip": 0.0033003301359713078,
      "sparse_tokens": 11173.0,
      "step": 11954,
      "turn_loss": 0.1924464851617813,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5554265006504367,
      "grad_norm": 0.28746655583381653,
      "learning_rate": 3.699279798297095e-10,
      "loss": 0.0874,
      "mae_dtheta": 0.01033671572804451,
      "mae_dx": 0.0014946069568395615,
      "mae_dy": 0.0021691699512302876,
      "pose_mae_dtheta": 0.06906777620315552,
      "pose_mae_dx": 0.01836930401623249,
      "pose_mae_dy": 0.023953605443239212,
      "pose_rmse_dtheta": 0.17902792990207672,
      "pose_rmse_dx": 0.054530754685401917,
      "pose_rmse_dy": 0.05547872185707092,
      "pose_rmse_mean": 0.09634580463171005,
      "rmse_dtheta": 0.023659754544496536,
      "rmse_dx": 0.005699439439922571,
      "rmse_dy": 0.005046166479587555,
      "rmse_mean": 0.011468453332781792,
      "rotation_flip": 0.005947323516011238,
      "sparse_tokens": 32073.0,
      "step": 11955,
      "turn_loss": 0.08296605944633484,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 12958.0,
      "epoch": 0.5554729604162795,
      "grad_norm": 0.7160479426383972,
      "learning_rate": 3.540191665457604e-10,
      "loss": 0.1636,
      "mae_dtheta": 0.03446293994784355,
      "mae_dx": 0.011675982736051083,
      "mae_dy": 0.004456967115402222,
      "pose_mae_dtheta": 0.26654624938964844,
      "pose_mae_dx": 0.0865970328450203,
      "pose_mae_dy": 0.05988328158855438,
      "pose_rmse_dtheta": 0.4875202178955078,
      "pose_rmse_dx": 0.19439692795276642,
      "pose_rmse_dy": 0.14148195087909698,
      "pose_rmse_mean": 0.2744663655757904,
      "rmse_dtheta": 0.05436822772026062,
      "rmse_dx": 0.023608798161149025,
      "rmse_dy": 0.00871754065155983,
      "rmse_mean": 0.028898190706968307,
      "rotation_flip": 0.014827017672359943,
      "sparse_tokens": 10086.0,
      "step": 11956,
      "turn_loss": 0.20998349785804749,
      "turns": 40.0,
      "turns_per_sample": 40.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5555194201821223,
      "grad_norm": 0.3722357153892517,
      "learning_rate": 3.384599811889766e-10,
      "loss": 0.0881,
      "mae_dtheta": 0.00903021078556776,
      "mae_dx": 0.0028424144256860018,
      "mae_dy": 0.003669233061373234,
      "pose_mae_dtheta": 0.06078239902853966,
      "pose_mae_dx": 0.026053955778479576,
      "pose_mae_dy": 0.02750355750322342,
      "pose_rmse_dtheta": 0.1546628773212433,
      "pose_rmse_dx": 0.07314175367355347,
      "pose_rmse_dy": 0.07015050202608109,
      "pose_rmse_mean": 0.09931837767362595,
      "rmse_dtheta": 0.02136998251080513,
      "rmse_dx": 0.007575071882456541,
      "rmse_dy": 0.008915500715374947,
      "rmse_mean": 0.012620186433196068,
      "rotation_flip": 0.005147058982402086,
      "sparse_tokens": 32121.0,
      "step": 11957,
      "turn_loss": 0.11266059428453445,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.555565879947965,
      "grad_norm": 0.3795756697654724,
      "learning_rate": 3.232504248468216e-10,
      "loss": 0.0814,
      "mae_dtheta": 0.00685160281136632,
      "mae_dx": 0.0010979071957990527,
      "mae_dy": 0.001418995438143611,
      "pose_mae_dtheta": 0.0454183854162693,
      "pose_mae_dx": 0.015041540376842022,
      "pose_mae_dy": 0.01887761987745762,
      "pose_rmse_dtheta": 0.14746472239494324,
      "pose_rmse_dx": 0.051313161849975586,
      "pose_rmse_dy": 0.056890975683927536,
      "pose_rmse_mean": 0.08522295206785202,
      "rmse_dtheta": 0.019506484270095825,
      "rmse_dx": 0.003385203192010522,
      "rmse_dy": 0.0038721158634871244,
      "rmse_mean": 0.008921267464756966,
      "rotation_flip": 0.0030975735280662775,
      "sparse_tokens": 32089.0,
      "step": 11958,
      "turn_loss": 0.05435766279697418,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5556123397138079,
      "grad_norm": 0.655814528465271,
      "learning_rate": 3.0839049858344406e-10,
      "loss": 0.1266,
      "mae_dtheta": 0.006950546056032181,
      "mae_dx": 0.0015132081462070346,
      "mae_dy": 0.001239289646036923,
      "pose_mae_dtheta": 0.045627012848854065,
      "pose_mae_dx": 0.014816091395914555,
      "pose_mae_dy": 0.016404135152697563,
      "pose_rmse_dtheta": 0.10231798887252808,
      "pose_rmse_dx": 0.03764616698026657,
      "pose_rmse_dy": 0.03712472692131996,
      "pose_rmse_mean": 0.059029631316661835,
      "rmse_dtheta": 0.015889691188931465,
      "rmse_dx": 0.0046759662218391895,
      "rmse_dy": 0.002595461905002594,
      "rmse_mean": 0.0077203731052577496,
      "rotation_flip": 0.002991453045979142,
      "sparse_tokens": 32137.0,
      "step": 11959,
      "turn_loss": 0.0621357262134552,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5556587994796506,
      "grad_norm": 0.28796473145484924,
      "learning_rate": 2.9388020343801283e-10,
      "loss": 0.0794,
      "mae_dtheta": 0.00785535853356123,
      "mae_dx": 0.00167057104408741,
      "mae_dy": 0.0030036000534892082,
      "pose_mae_dtheta": 0.049947723746299744,
      "pose_mae_dx": 0.02350749261677265,
      "pose_mae_dy": 0.024094918742775917,
      "pose_rmse_dtheta": 0.101650670170784,
      "pose_rmse_dx": 0.0779329389333725,
      "pose_rmse_dy": 0.05585046857595444,
      "pose_rmse_mean": 0.07847803086042404,
      "rmse_dtheta": 0.016211064532399178,
      "rmse_dx": 0.00486449571326375,
      "rmse_dy": 0.00716985622420907,
      "rmse_mean": 0.009415138512849808,
      "rotation_flip": 0.005832211580127478,
      "sparse_tokens": 32057.0,
      "step": 11960,
      "turn_loss": 0.07670041173696518,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5529.0,
      "epoch": 0.5557052592454934,
      "grad_norm": 0.6100994944572449,
      "learning_rate": 2.797195404247166e-10,
      "loss": 0.1546,
      "mae_dtheta": 0.04176758974790573,
      "mae_dx": 0.007344727870076895,
      "mae_dy": 0.0027175794821232557,
      "pose_mae_dtheta": 0.36659693717956543,
      "pose_mae_dx": 0.06048175320029259,
      "pose_mae_dy": 0.023740218952298164,
      "pose_rmse_dtheta": 0.6292998790740967,
      "pose_rmse_dx": 0.13812610507011414,
      "pose_rmse_dy": 0.04926624521613121,
      "pose_rmse_mean": 0.27223074436187744,
      "rmse_dtheta": 0.06214641034603119,
      "rmse_dx": 0.017958611249923706,
      "rmse_dy": 0.006021591369062662,
      "rmse_mean": 0.028708871454000473,
      "rotation_flip": 0.007220216561108828,
      "sparse_tokens": 4715.0,
      "step": 11961,
      "turn_loss": 0.20347005128860474,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 14294.0,
      "epoch": 0.5557517190113361,
      "grad_norm": 0.45676106214523315,
      "learning_rate": 2.6590851053442945e-10,
      "loss": 0.1256,
      "mae_dtheta": 0.01926780305802822,
      "mae_dx": 0.012208078987896442,
      "mae_dy": 0.003812307957559824,
      "pose_mae_dtheta": 0.14476102590560913,
      "pose_mae_dx": 0.08622254431247711,
      "pose_mae_dy": 0.05593786761164665,
      "pose_rmse_dtheta": 0.2500946819782257,
      "pose_rmse_dx": 0.19946429133415222,
      "pose_rmse_dy": 0.14759846031665802,
      "pose_rmse_mean": 0.19905248284339905,
      "rmse_dtheta": 0.03209846839308739,
      "rmse_dx": 0.025477835908532143,
      "rmse_dy": 0.007718927692621946,
      "rmse_mean": 0.021765079349279404,
      "rotation_flip": 0.009615384973585606,
      "sparse_tokens": 11671.0,
      "step": 11962,
      "turn_loss": 0.17424233257770538,
      "turns": 44.0,
      "turns_per_sample": 44.0
    },
    {
      "dense_tokens": 7144.0,
      "epoch": 0.555798178777179,
      "grad_norm": 0.5691315531730652,
      "learning_rate": 2.5244711473249027e-10,
      "loss": 0.1233,
      "mae_dtheta": 0.036256566643714905,
      "mae_dx": 0.009156810119748116,
      "mae_dy": 0.008668146096169949,
      "pose_mae_dtheta": 0.27712175250053406,
      "pose_mae_dx": 0.0808463990688324,
      "pose_mae_dy": 0.08869460225105286,
      "pose_rmse_dtheta": 0.4782542884349823,
      "pose_rmse_dx": 0.14804530143737793,
      "pose_rmse_dy": 0.17598916590213776,
      "pose_rmse_mean": 0.2674295902252197,
      "rmse_dtheta": 0.05747970566153526,
      "rmse_dx": 0.019080765545368195,
      "rmse_dy": 0.014590802602469921,
      "rmse_mean": 0.030383756384253502,
      "rotation_flip": 0.01666666753590107,
      "sparse_tokens": 6267.0,
      "step": 11963,
      "turn_loss": 0.34766557812690735,
      "turns": 22.0,
      "turns_per_sample": 22.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5558446385430218,
      "grad_norm": 0.37859320640563965,
      "learning_rate": 2.3933535396092333e-10,
      "loss": 0.0739,
      "mae_dtheta": 0.005716113373637199,
      "mae_dx": 0.0007695935200899839,
      "mae_dy": 0.0006085318746045232,
      "pose_mae_dtheta": 0.03730672597885132,
      "pose_mae_dx": 0.005439028609544039,
      "pose_mae_dy": 0.006225446704775095,
      "pose_rmse_dtheta": 0.17673298716545105,
      "pose_rmse_dx": 0.013642978854477406,
      "pose_rmse_dy": 0.01724204607307911,
      "pose_rmse_mean": 0.06920600682497025,
      "rmse_dtheta": 0.0227462537586689,
      "rmse_dx": 0.002496958477422595,
      "rmse_dy": 0.0031032362021505833,
      "rmse_mean": 0.009448816068470478,
      "rotation_flip": 0.0036275694146752357,
      "sparse_tokens": 32137.0,
      "step": 11964,
      "turn_loss": 0.03134685382246971,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5558910983088645,
      "grad_norm": 0.37960466742515564,
      "learning_rate": 2.265732291356626e-10,
      "loss": 0.0901,
      "mae_dtheta": 0.01018269918859005,
      "mae_dx": 0.0015460009453818202,
      "mae_dy": 0.00245789997279644,
      "pose_mae_dtheta": 0.0715624988079071,
      "pose_mae_dx": 0.023158034309744835,
      "pose_mae_dy": 0.03059655800461769,
      "pose_rmse_dtheta": 0.18469515442848206,
      "pose_rmse_dx": 0.06075214222073555,
      "pose_rmse_dy": 0.08283280581235886,
      "pose_rmse_mean": 0.10942669957876205,
      "rmse_dtheta": 0.02201670967042446,
      "rmse_dx": 0.0048057204112410545,
      "rmse_dy": 0.005425030831247568,
      "rmse_mean": 0.010749153792858124,
      "rotation_flip": 0.0036407767329365015,
      "sparse_tokens": 32089.0,
      "step": 11965,
      "turn_loss": 0.08671782910823822,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5559375580747073,
      "grad_norm": 0.42067962884902954,
      "learning_rate": 2.141607411498825e-10,
      "loss": 0.0832,
      "mae_dtheta": 0.01189168356359005,
      "mae_dx": 0.0020201087463647127,
      "mae_dy": 0.0032548061572015285,
      "pose_mae_dtheta": 0.08066349476575851,
      "pose_mae_dx": 0.02691507525742054,
      "pose_mae_dy": 0.03449135273694992,
      "pose_rmse_dtheta": 0.19027821719646454,
      "pose_rmse_dx": 0.06732819229364395,
      "pose_rmse_dy": 0.08281069248914719,
      "pose_rmse_mean": 0.11347237229347229,
      "rmse_dtheta": 0.024432195350527763,
      "rmse_dx": 0.005924430675804615,
      "rmse_dy": 0.007728281896561384,
      "rmse_mean": 0.012694969773292542,
      "rotation_flip": 0.005500549916177988,
      "sparse_tokens": 32089.0,
      "step": 11966,
      "turn_loss": 0.11661937832832336,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5559840178405501,
      "grad_norm": 0.2850145101547241,
      "learning_rate": 2.0209789087122233e-10,
      "loss": 0.0629,
      "mae_dtheta": 0.008823663927614689,
      "mae_dx": 0.00176435976754874,
      "mae_dy": 0.0019725870806723833,
      "pose_mae_dtheta": 0.05665430799126625,
      "pose_mae_dx": 0.02034047432243824,
      "pose_mae_dy": 0.026545733213424683,
      "pose_rmse_dtheta": 0.1253347396850586,
      "pose_rmse_dx": 0.06344062834978104,
      "pose_rmse_dy": 0.0615193247795105,
      "pose_rmse_mean": 0.08343156427145004,
      "rmse_dtheta": 0.01908336579799652,
      "rmse_dx": 0.006627918686717749,
      "rmse_dy": 0.0046523683704435825,
      "rmse_mean": 0.010121217928826809,
      "rotation_flip": 0.0024701522197574377,
      "sparse_tokens": 32073.0,
      "step": 11967,
      "turn_loss": 0.06743964552879333,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64537.0,
      "epoch": 0.5560304776063929,
      "grad_norm": 0.27503061294555664,
      "learning_rate": 1.903846791434516e-10,
      "loss": 0.0624,
      "mae_dtheta": 0.008689041249454021,
      "mae_dx": 0.0018922535236924887,
      "mae_dy": 0.0012344170827418566,
      "pose_mae_dtheta": 0.05683978274464607,
      "pose_mae_dx": 0.01904468797147274,
      "pose_mae_dy": 0.016677329316735268,
      "pose_rmse_dtheta": 0.18029364943504333,
      "pose_rmse_dx": 0.07353498041629791,
      "pose_rmse_dy": 0.06031220406293869,
      "pose_rmse_mean": 0.10471361875534058,
      "rmse_dtheta": 0.024137334898114204,
      "rmse_dx": 0.007713619619607925,
      "rmse_dy": 0.0037855717819184065,
      "rmse_mean": 0.011878843419253826,
      "rotation_flip": 0.004668534267693758,
      "sparse_tokens": 32137.0,
      "step": 11968,
      "turn_loss": 0.07721938192844391,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.5560769373722356,
      "grad_norm": 0.4678668677806854,
      "learning_rate": 1.790211067859149e-10,
      "loss": 0.104,
      "mae_dtheta": 0.011122513562440872,
      "mae_dx": 0.0015455018728971481,
      "mae_dy": 0.0028338029514998198,
      "pose_mae_dtheta": 0.07251206785440445,
      "pose_mae_dx": 0.021912584081292152,
      "pose_mae_dy": 0.030884074047207832,
      "pose_rmse_dtheta": 0.16523508727550507,
      "pose_rmse_dx": 0.058231107890605927,
      "pose_rmse_dy": 0.07126118987798691,
      "pose_rmse_mean": 0.09824246168136597,
      "rmse_dtheta": 0.022283585742115974,
      "rmse_dx": 0.004572990350425243,
      "rmse_dy": 0.005849120672792196,
      "rmse_mean": 0.01090189814567566,
      "rotation_flip": 0.0027387880254536867,
      "sparse_tokens": 32105.0,
      "step": 11969,
      "turn_loss": 0.094418004155159,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 15542.0,
      "epoch": 0.5561233971380785,
      "grad_norm": 0.740606427192688,
      "learning_rate": 1.6800717459297678e-10,
      "loss": 0.1614,
      "mae_dtheta": 0.032172221690416336,
      "mae_dx": 0.01014684233814478,
      "mae_dy": 0.0034435095731168985,
      "pose_mae_dtheta": 0.2545444369316101,
      "pose_mae_dx": 0.08063109964132309,
      "pose_mae_dy": 0.0432925671339035,
      "pose_rmse_dtheta": 0.5105727314949036,
      "pose_rmse_dx": 0.1776038259267807,
      "pose_rmse_dy": 0.11401639878749847,
      "pose_rmse_mean": 0.2673976719379425,
      "rmse_dtheta": 0.05285497009754181,
      "rmse_dx": 0.02158464305102825,
      "rmse_dy": 0.006876993924379349,
      "rmse_mean": 0.027105536311864853,
      "rotation_flip": 0.011816838756203651,
      "sparse_tokens": 12708.0,
      "step": 11970,
      "turn_loss": 0.23153121769428253,
      "turns": 48.0,
      "turns_per_sample": 48.0
    },
    {
      "dense_tokens": 64489.0,
      "epoch": 0.5561698569039212,
      "grad_norm": 0.5007762312889099,
      "learning_rate": 1.5734288333457692e-10,
      "loss": 0.1327,
      "mae_dtheta": 0.012766612693667412,
      "mae_dx": 0.0037538360338658094,
      "mae_dy": 0.0027792465407401323,
      "pose_mae_dtheta": 0.0921158716082573,
      "pose_mae_dx": 0.03217914700508118,
      "pose_mae_dy": 0.024734240025281906,
      "pose_rmse_dtheta": 0.2676597237586975,
      "pose_rmse_dx": 0.09915105998516083,
      "pose_rmse_dy": 0.0671016201376915,
      "pose_rmse_mean": 0.14463748037815094,
      "rmse_dtheta": 0.030985379591584206,
      "rmse_dx": 0.012712339870631695,
      "rmse_dy": 0.007250676862895489,
      "rmse_mean": 0.016982799395918846,
      "rotation_flip": 0.009077155962586403,
      "sparse_tokens": 32089.0,
      "step": 11971,
      "turn_loss": 0.1093011274933815,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 1336.0,
      "epoch": 0.556216316669764,
      "grad_norm": 0.6924299001693726,
      "learning_rate": 1.470282337567852e-10,
      "loss": 0.1162,
      "mae_dtheta": 0.011324591934680939,
      "mae_dx": 0.019477330148220062,
      "mae_dy": 0.0031243995763361454,
      "pose_mae_dtheta": 0.09215865284204483,
      "pose_mae_dx": 0.11926771700382233,
      "pose_mae_dy": 0.02775450050830841,
      "pose_rmse_dtheta": 0.1287676990032196,
      "pose_rmse_dx": 0.196287140250206,
      "pose_rmse_dy": 0.04506522789597511,
      "pose_rmse_mean": 0.1233733519911766,
      "rmse_dtheta": 0.01715008355677128,
      "rmse_dx": 0.029750755056738853,
      "rmse_dy": 0.0041129752062261105,
      "rmse_mean": 0.017004605382680893,
      "rotation_flip": 0.0,
      "sparse_tokens": 1133.0,
      "step": 11972,
      "turn_loss": 0.11624335497617722,
      "turns": 4.0,
      "turns_per_sample": 4.0
    },
    {
      "dense_tokens": 9758.0,
      "epoch": 0.5562627764356067,
      "grad_norm": 0.8217676281929016,
      "learning_rate": 1.370632265812466e-10,
      "loss": 0.1669,
      "mae_dtheta": 0.03853640332818031,
      "mae_dx": 0.012361337430775166,
      "mae_dy": 0.005369346123188734,
      "pose_mae_dtheta": 0.3226710855960846,
      "pose_mae_dx": 0.10376816242933273,
      "pose_mae_dy": 0.06127924844622612,
      "pose_rmse_dtheta": 0.5653880834579468,
      "pose_rmse_dx": 0.20845341682434082,
      "pose_rmse_dy": 0.13122433423995972,
      "pose_rmse_mean": 0.30168861150741577,
      "rmse_dtheta": 0.05709940567612648,
      "rmse_dx": 0.0247852373868227,
      "rmse_dy": 0.009710039012134075,
      "rmse_mean": 0.030531561002135277,
      "rotation_flip": 0.015533980913460255,
      "sparse_tokens": 8326.0,
      "step": 11973,
      "turn_loss": 0.2953585386276245,
      "turns": 30.0,
      "turns_per_sample": 30.0
    },
    {
      "dense_tokens": 3591.0,
      "epoch": 0.5563092362014496,
      "grad_norm": 0.5650802850723267,
      "learning_rate": 1.2744786250407092e-10,
      "loss": 0.1057,
      "mae_dtheta": 0.041275449097156525,
      "mae_dx": 0.02214553765952587,
      "mae_dy": 0.013945696875452995,
      "pose_mae_dtheta": 0.3398955166339874,
      "pose_mae_dx": 0.17563626170158386,
      "pose_mae_dy": 0.2289024442434311,
      "pose_rmse_dtheta": 0.6262328624725342,
      "pose_rmse_dx": 0.31948262453079224,
      "pose_rmse_dy": 0.39527881145477295,
      "pose_rmse_mean": 0.44699811935424805,
      "rmse_dtheta": 0.06083965674042702,
      "rmse_dx": 0.03700939938426018,
      "rmse_dy": 0.02378741092979908,
      "rmse_mean": 0.04054548963904381,
      "rotation_flip": 0.005376344081014395,
      "sparse_tokens": 2956.0,
      "step": 11974,
      "turn_loss": 0.5467058420181274,
      "turns": 11.0,
      "turns_per_sample": 11.0
    },
    {
      "dense_tokens": 20450.0,
      "epoch": 0.5563556959672923,
      "grad_norm": 0.5459479689598083,
      "learning_rate": 1.1818214219805336e-10,
      "loss": 0.1257,
      "mae_dtheta": 0.02918519452214241,
      "mae_dx": 0.00886182114481926,
      "mae_dy": 0.005555316805839539,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.5459479093551636,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 160.6190185546875,
      "model/head/act_norm_mean": 103.84461030505952,
      "model/head/act_norm_min": 63.459442138671875,
      "model/head/act_over_embed": 71.36298841019597,
      "model/head/grad_frac": 0.09920109063386917,
      "model/head/grad_norm": 0.05415862798690796,
      "model/head/grad_zero_frac": 0.00019988120766356587,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6928478422619048,
      "model/head/update_ratio": 0.0009219276835210621,
      "model/head/weight_delta": 9.986141204833984,
      "model/head/weight_delta_rel": 0.17518649995326996,
      "model/head/weight_norm": 58.7449836730957,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42294198274612427,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228724539279938,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42281314730644226,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29060190933360597,
      "model/modality_embedder.encoders.pose/grad_frac": 0.12722820043563843,
      "model/modality_embedder.encoders.pose/grad_norm": 0.06945996731519699,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.522430419921875,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0022428245283663273,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569366455078125,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314696282148361,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96986198425293,
      "model/modality_embedder/grad_frac": 0.12722820043563843,
      "model/modality_embedder/grad_norm": 0.06945996731519699,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.522430419921875,
      "model/modality_embedder/update_ratio": 0.0022428245283663273,
      "model/modality_embedder/weight_delta": 3.1569366455078125,
      "model/modality_embedder/weight_delta_rel": 0.10314696282148361,
      "model/modality_embedder/weight_norm": 30.96986198425293,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 88.69319152832031,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 23.092661485890652,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.322748184204102,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.869493170007125,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.0707179382443428,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.038608308881521225,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00022191736206877977,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0013807776849716902,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7429442405700684,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995454549789429,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961278915405273,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 90.28045654296875,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.90779517825649,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.785996437072754,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.42966067480279,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.0652470588684082,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.03562149405479431,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0011965172598138452,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.477712869644165,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12047069519758224,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77098274230957,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 92.07559204101562,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.61419949924414,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.341459274291992,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.602317699794458,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.06903064250946045,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.03768713399767876,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00023704809427727014,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0012258939677849412,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7677226066589355,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1265130639076233,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742572784423828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 92.76082611083984,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 27.49122693058705,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 12.968381881713867,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.892228523620986,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.06259889900684357,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.03417573869228363,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.00016643802518956363,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0011408720165491104,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2387850284576416,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1106863021850586,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9558048248291,
      "model/normalizer/grad_frac": 0.26381415128707886,
      "model/normalizer/grad_norm": 0.14402878284454346,
      "model/normalizer/grad_zero_frac": 0.0002280755143146962,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0018310722662135959,
      "model/normalizer/weight_delta": 6.810962677001953,
      "model/normalizer/weight_delta_rel": 0.08772125840187073,
      "model/normalizer/weight_norm": 78.65816497802734,
      "pose_mae_dtheta": 0.20874208211898804,
      "pose_mae_dx": 0.06464621424674988,
      "pose_mae_dy": 0.071347177028656,
      "pose_rmse_dtheta": 0.3929758369922638,
      "pose_rmse_dx": 0.14621205627918243,
      "pose_rmse_dy": 0.18343959748744965,
      "pose_rmse_mean": 0.24087584018707275,
      "rmse_dtheta": 0.047300394624471664,
      "rmse_dx": 0.01988809183239937,
      "rmse_dy": 0.012754811905324459,
      "rmse_mean": 0.026647767052054405,
      "rotation_flip": 0.012160898186266422,
      "sparse_tokens": 15483.0,
      "step": 11975,
      "turn_loss": 0.23547333478927612,
      "turns": 63.0,
      "turns_per_sample": 63.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5564021557331351,
      "grad_norm": 0.4134465754032135,
      "learning_rate": 1.0926606631156411e-10,
      "loss": 0.1134,
      "mae_dtheta": 0.01018554624170065,
      "mae_dx": 0.001254198607057333,
      "mae_dy": 0.0024021111894398928,
      "pose_mae_dtheta": 0.06396002322435379,
      "pose_mae_dx": 0.01914490945637226,
      "pose_mae_dy": 0.029446152970194817,
      "pose_rmse_dtheta": 0.16340166330337524,
      "pose_rmse_dx": 0.057388417422771454,
      "pose_rmse_dy": 0.07724840193986893,
      "pose_rmse_mean": 0.09934616088867188,
      "rmse_dtheta": 0.021496564149856567,
      "rmse_dx": 0.003905761055648327,
      "rmse_dy": 0.005373319610953331,
      "rmse_mean": 0.010258548893034458,
      "rotation_flip": 0.005446166731417179,
      "sparse_tokens": 32057.0,
      "step": 11976,
      "turn_loss": 0.0812041386961937,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 5546.0,
      "epoch": 0.5564486154989778,
      "grad_norm": 0.661529541015625,
      "learning_rate": 1.0069963546743833e-10,
      "loss": 0.0954,
      "mae_dtheta": 0.03676183894276619,
      "mae_dx": 0.01233087107539177,
      "mae_dy": 0.005744622554630041,
      "pose_mae_dtheta": 0.25364696979522705,
      "pose_mae_dx": 0.10484468936920166,
      "pose_mae_dy": 0.09100618213415146,
      "pose_rmse_dtheta": 0.3824869990348816,
      "pose_rmse_dx": 0.23222845792770386,
      "pose_rmse_dy": 0.1825774908065796,
      "pose_rmse_mean": 0.2657643258571625,
      "rmse_dtheta": 0.05161114037036896,
      "rmse_dx": 0.025941798463463783,
      "rmse_dy": 0.008570000529289246,
      "rmse_mean": 0.02870764583349228,
      "rotation_flip": 0.01702127605676651,
      "sparse_tokens": 4971.0,
      "step": 11977,
      "turn_loss": 0.23291601240634918,
      "turns": 17.0,
      "turns_per_sample": 17.0
    },
    {
      "dense_tokens": 37198.0,
      "epoch": 0.5564950752648207,
      "grad_norm": 0.5287682414054871,
      "learning_rate": 9.248285026519643e-11,
      "loss": 0.1313,
      "mae_dtheta": 0.03389224410057068,
      "mae_dx": 0.011053318157792091,
      "mae_dy": 0.006049880757927895,
      "pose_mae_dtheta": 0.27102750539779663,
      "pose_mae_dx": 0.087490014731884,
      "pose_mae_dy": 0.06980112940073013,
      "pose_rmse_dtheta": 0.5012849569320679,
      "pose_rmse_dx": 0.19568338990211487,
      "pose_rmse_dy": 0.19782571494579315,
      "pose_rmse_mean": 0.29826468229293823,
      "rmse_dtheta": 0.05474724620580673,
      "rmse_dx": 0.022395648062229156,
      "rmse_dy": 0.015227924101054668,
      "rmse_mean": 0.03079027310013771,
      "rotation_flip": 0.012650221586227417,
      "sparse_tokens": 29322.0,
      "step": 11978,
      "turn_loss": 0.25840917229652405,
      "turns": 115.0,
      "turns_per_sample": 115.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.5565415350306634,
      "grad_norm": 0.4987928569316864,
      "learning_rate": 8.461571127882373e-11,
      "loss": 0.1163,
      "mae_dtheta": 0.036026619374752045,
      "mae_dx": 0.011872406117618084,
      "mae_dy": 0.0054518175311386585,
      "pose_mae_dtheta": 0.2621005177497864,
      "pose_mae_dx": 0.08734363317489624,
      "pose_mae_dy": 0.07978688925504684,
      "pose_rmse_dtheta": 0.5040175914764404,
      "pose_rmse_dx": 0.2143602967262268,
      "pose_rmse_dy": 0.23767656087875366,
      "pose_rmse_mean": 0.31868481636047363,
      "rmse_dtheta": 0.05604369193315506,
      "rmse_dx": 0.025535887107253075,
      "rmse_dy": 0.011621871031820774,
      "rmse_mean": 0.031067151576280594,
      "rotation_flip": 0.015789473429322243,
      "sparse_tokens": 6293.0,
      "step": 11979,
      "turn_loss": 0.2865324914455414,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 22002.0,
      "epoch": 0.5565879947965062,
      "grad_norm": 0.8854707479476929,
      "learning_rate": 7.709821905954595e-11,
      "loss": 0.1574,
      "mae_dtheta": 0.026776928454637527,
      "mae_dx": 0.009767848998308182,
      "mae_dy": 0.002811420476064086,
      "pose_mae_dtheta": 0.22465310990810394,
      "pose_mae_dx": 0.08963404595851898,
      "pose_mae_dy": 0.03744632750749588,
      "pose_rmse_dtheta": 0.40329980850219727,
      "pose_rmse_dx": 0.2182232141494751,
      "pose_rmse_dy": 0.08583413809537888,
      "pose_rmse_mean": 0.23578572273254395,
      "rmse_dtheta": 0.044089678674936295,
      "rmse_dx": 0.021485939621925354,
      "rmse_dy": 0.005678254179656506,
      "rmse_mean": 0.023751288652420044,
      "rotation_flip": 0.01430030632764101,
      "sparse_tokens": 15339.0,
      "step": 11980,
      "turn_loss": 0.22800882160663605,
      "turns": 68.0,
      "turns_per_sample": 68.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5566344545623491,
      "grad_norm": 0.4122731685638428,
      "learning_rate": 6.993037413194348e-11,
      "loss": 0.0837,
      "mae_dtheta": 0.006756766699254513,
      "mae_dx": 0.0007912561413832009,
      "mae_dy": 0.0011030194582417607,
      "pose_mae_dtheta": 0.0503004789352417,
      "pose_mae_dx": 0.00915768463164568,
      "pose_mae_dy": 0.017552724108099937,
      "pose_rmse_dtheta": 0.15878988802433014,
      "pose_rmse_dx": 0.02130478248000145,
      "pose_rmse_dy": 0.04159007593989372,
      "pose_rmse_mean": 0.0738949179649353,
      "rmse_dtheta": 0.01847822032868862,
      "rmse_dx": 0.002502863761037588,
      "rmse_dy": 0.0023113719653338194,
      "rmse_mean": 0.007764152251183987,
      "rotation_flip": 0.003004291793331504,
      "sparse_tokens": 32121.0,
      "step": 11981,
      "turn_loss": 0.04376840963959694,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 22394.0,
      "epoch": 0.5566809143281918,
      "grad_norm": 0.47508519887924194,
      "learning_rate": 6.311217699783712e-11,
      "loss": 0.1564,
      "mae_dtheta": 0.03237053006887436,
      "mae_dx": 0.011763203889131546,
      "mae_dy": 0.003707048948854208,
      "pose_mae_dtheta": 0.2470385879278183,
      "pose_mae_dx": 0.09569436311721802,
      "pose_mae_dy": 0.041707102209329605,
      "pose_rmse_dtheta": 0.4561536908149719,
      "pose_rmse_dx": 0.2210012674331665,
      "pose_rmse_dy": 0.1293592005968094,
      "pose_rmse_mean": 0.2688380479812622,
      "rmse_dtheta": 0.05076954513788223,
      "rmse_dx": 0.024697117507457733,
      "rmse_dy": 0.009568312205374241,
      "rmse_mean": 0.02834499254822731,
      "rotation_flip": 0.008442776277661324,
      "sparse_tokens": 17699.0,
      "step": 11982,
      "turn_loss": 0.24742856621742249,
      "turns": 69.0,
      "turns_per_sample": 69.0
    },
    {
      "dense_tokens": 64457.0,
      "epoch": 0.5567273740940346,
      "grad_norm": 0.7179516553878784,
      "learning_rate": 5.6643628134067655e-11,
      "loss": 0.134,
      "mae_dtheta": 0.008968702517449856,
      "mae_dx": 0.0018593808636069298,
      "mae_dy": 0.0019362005405128002,
      "pose_mae_dtheta": 0.05691524222493172,
      "pose_mae_dx": 0.02275191992521286,
      "pose_mae_dy": 0.02775050513446331,
      "pose_rmse_dtheta": 0.12323856353759766,
      "pose_rmse_dx": 0.05501960963010788,
      "pose_rmse_dy": 0.061932001262903214,
      "pose_rmse_mean": 0.08006339520215988,
      "rmse_dtheta": 0.019391294568777084,
      "rmse_dx": 0.0055052232928574085,
      "rmse_dy": 0.0040332661010324955,
      "rmse_mean": 0.009643261320888996,
      "rotation_flip": 0.006902502384036779,
      "sparse_tokens": 32057.0,
      "step": 11983,
      "turn_loss": 0.07798872143030167,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 3914.0,
      "epoch": 0.5567738338598773,
      "grad_norm": 0.8180315494537354,
      "learning_rate": 5.052472799249586e-11,
      "loss": 0.1527,
      "mae_dtheta": 0.03857138380408287,
      "mae_dx": 0.012543435208499432,
      "mae_dy": 0.01576116867363453,
      "pose_mae_dtheta": 0.34649237990379333,
      "pose_mae_dx": 0.0803535133600235,
      "pose_mae_dy": 0.17751049995422363,
      "pose_rmse_dtheta": 0.5085405111312866,
      "pose_rmse_dx": 0.1478654146194458,
      "pose_rmse_dy": 0.3043154180049896,
      "pose_rmse_mean": 0.32024046778678894,
      "rmse_dtheta": 0.05257585644721985,
      "rmse_dx": 0.024590017274022102,
      "rmse_dy": 0.02445259690284729,
      "rmse_mean": 0.0338728241622448,
      "rotation_flip": 0.014778325334191322,
      "sparse_tokens": 3422.0,
      "step": 11984,
      "turn_loss": 0.5668744444847107,
      "turns": 12.0,
      "turns_per_sample": 12.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.5568202936257202,
      "grad_norm": 0.5785300135612488,
      "learning_rate": 4.4755477001667824e-11,
      "loss": 0.1466,
      "mae_dtheta": 0.007186960428953171,
      "mae_dx": 0.001155321253463626,
      "mae_dy": 0.0014757912140339613,
      "pose_mae_dtheta": 0.04774860292673111,
      "pose_mae_dx": 0.014175712130963802,
      "pose_mae_dy": 0.018078697845339775,
      "pose_rmse_dtheta": 0.12920977175235748,
      "pose_rmse_dx": 0.03580990061163902,
      "pose_rmse_dy": 0.04028040170669556,
      "pose_rmse_mean": 0.06843335926532745,
      "rmse_dtheta": 0.018965935334563255,
      "rmse_dx": 0.0036112733650952578,
      "rmse_dy": 0.0033341958187520504,
      "rmse_mean": 0.008637135848402977,
      "rotation_flip": 0.0035906643606722355,
      "sparse_tokens": 32073.0,
      "step": 11985,
      "turn_loss": 0.05039261281490326,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 17480.0,
      "epoch": 0.5568667533915629,
      "grad_norm": 0.809998631477356,
      "learning_rate": 3.9335875564594505e-11,
      "loss": 0.2048,
      "mae_dtheta": 0.05209552124142647,
      "mae_dx": 0.01259026862680912,
      "mae_dy": 0.005460528656840324,
      "pose_mae_dtheta": 0.4561493396759033,
      "pose_mae_dx": 0.09358929842710495,
      "pose_mae_dy": 0.05952462553977966,
      "pose_rmse_dtheta": 0.6903883218765259,
      "pose_rmse_dx": 0.1996012032032013,
      "pose_rmse_dy": 0.152430921792984,
      "pose_rmse_mean": 0.34747347235679626,
      "rmse_dtheta": 0.06960035115480423,
      "rmse_dx": 0.023768626153469086,
      "rmse_dy": 0.01241427194327116,
      "rmse_mean": 0.03526108339428902,
      "rotation_flip": 0.013431013561785221,
      "sparse_tokens": 13397.0,
      "step": 11986,
      "turn_loss": 0.39992526173591614,
      "turns": 54.0,
      "turns_per_sample": 54.0
    },
    {
      "dense_tokens": 12312.0,
      "epoch": 0.5569132131574057,
      "grad_norm": 0.6856940984725952,
      "learning_rate": 3.4265924060417066e-11,
      "loss": 0.148,
      "mae_dtheta": 0.04146461561322212,
      "mae_dx": 0.014271541498601437,
      "mae_dy": 0.004102340433746576,
      "pose_mae_dtheta": 0.3436652421951294,
      "pose_mae_dx": 0.11701865494251251,
      "pose_mae_dy": 0.0645475685596466,
      "pose_rmse_dtheta": 0.566292405128479,
      "pose_rmse_dx": 0.2543228268623352,
      "pose_rmse_dy": 0.1421504020690918,
      "pose_rmse_mean": 0.3209218978881836,
      "rmse_dtheta": 0.059517212212085724,
      "rmse_dx": 0.027803592383861542,
      "rmse_dy": 0.007859149016439915,
      "rmse_mean": 0.0317266508936882,
      "rotation_flip": 0.01200686115771532,
      "sparse_tokens": 9677.0,
      "step": 11987,
      "turn_loss": 0.22679421305656433,
      "turns": 38.0,
      "turns_per_sample": 38.0
    },
    {
      "dense_tokens": 32663.0,
      "epoch": 0.5569596729232484,
      "grad_norm": 0.5176357626914978,
      "learning_rate": 2.954562284385176e-11,
      "loss": 0.1492,
      "mae_dtheta": 0.030930045992136,
      "mae_dx": 0.011897002346813679,
      "mae_dy": 0.004800569731742144,
      "pose_mae_dtheta": 0.24556398391723633,
      "pose_mae_dx": 0.09494711458683014,
      "pose_mae_dy": 0.057179421186447144,
      "pose_rmse_dtheta": 0.4278903901576996,
      "pose_rmse_dx": 0.21923981606960297,
      "pose_rmse_dy": 0.13786213099956512,
      "pose_rmse_mean": 0.26166412234306335,
      "rmse_dtheta": 0.047474898397922516,
      "rmse_dx": 0.02412921003997326,
      "rmse_dy": 0.010389270260930061,
      "rmse_mean": 0.027331126853823662,
      "rotation_flip": 0.01600000075995922,
      "sparse_tokens": 26388.0,
      "step": 11988,
      "turn_loss": 0.2657751739025116,
      "turns": 101.0,
      "turns_per_sample": 101.0
    },
    {
      "dense_tokens": 7490.0,
      "epoch": 0.5570061326890913,
      "grad_norm": 0.35638976097106934,
      "learning_rate": 2.5174972244634834e-11,
      "loss": 0.0732,
      "mae_dtheta": 0.04650381579995155,
      "mae_dx": 0.012092000804841518,
      "mae_dy": 0.005603336263448,
      "pose_mae_dtheta": 0.3759252727031708,
      "pose_mae_dx": 0.0917285904288292,
      "pose_mae_dy": 0.03652433305978775,
      "pose_rmse_dtheta": 0.6094613671302795,
      "pose_rmse_dx": 0.198438823223114,
      "pose_rmse_dy": 0.08905662596225739,
      "pose_rmse_mean": 0.2989856004714966,
      "rmse_dtheta": 0.0656711533665657,
      "rmse_dx": 0.02435021847486496,
      "rmse_dy": 0.015825586393475533,
      "rmse_mean": 0.03528232127428055,
      "rotation_flip": 0.012165450491011143,
      "sparse_tokens": 5916.0,
      "step": 11989,
      "turn_loss": 0.32647061347961426,
      "turns": 23.0,
      "turns_per_sample": 23.0
    },
    {
      "dense_tokens": 64505.0,
      "epoch": 0.557052592454934,
      "grad_norm": 0.6734200716018677,
      "learning_rate": 2.1153972568632718e-11,
      "loss": 0.0914,
      "mae_dtheta": 0.00844499934464693,
      "mae_dx": 0.0014627368655055761,
      "mae_dy": 0.0017351174028590322,
      "pose_mae_dtheta": 0.055018551647663116,
      "pose_mae_dx": 0.019423499703407288,
      "pose_mae_dy": 0.020904498174786568,
      "pose_rmse_dtheta": 0.11876308917999268,
      "pose_rmse_dx": 0.05513652786612511,
      "pose_rmse_dy": 0.05256963148713112,
      "pose_rmse_mean": 0.07548975199460983,
      "rmse_dtheta": 0.018709752708673477,
      "rmse_dx": 0.004429042339324951,
      "rmse_dy": 0.00433729263022542,
      "rmse_mean": 0.009158696047961712,
      "rotation_flip": 0.0039698295295238495,
      "sparse_tokens": 32105.0,
      "step": 11990,
      "turn_loss": 0.06586594879627228,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64569.0,
      "epoch": 0.5570990522207768,
      "grad_norm": 0.5954185724258423,
      "learning_rate": 1.748262409728696e-11,
      "loss": 0.1559,
      "mae_dtheta": 0.010321400128304958,
      "mae_dx": 0.0017241041641682386,
      "mae_dy": 0.002460088115185499,
      "pose_mae_dtheta": 0.06452226638793945,
      "pose_mae_dx": 0.01759340614080429,
      "pose_mae_dy": 0.02663654275238514,
      "pose_rmse_dtheta": 0.16258852183818817,
      "pose_rmse_dx": 0.04144710302352905,
      "pose_rmse_dy": 0.06950261443853378,
      "pose_rmse_mean": 0.09117941558361053,
      "rmse_dtheta": 0.023487204685807228,
      "rmse_dx": 0.005195971112698317,
      "rmse_dy": 0.00633165892213583,
      "rmse_mean": 0.011671612039208412,
      "rotation_flip": 0.004296455532312393,
      "sparse_tokens": 32169.0,
      "step": 11991,
      "turn_loss": 0.09933535009622574,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 18182.0,
      "epoch": 0.5571455119866195,
      "grad_norm": 0.37290799617767334,
      "learning_rate": 1.4160927086503962e-11,
      "loss": 0.1043,
      "mae_dtheta": 0.029528506100177765,
      "mae_dx": 0.007488825358450413,
      "mae_dy": 0.004352869000285864,
      "pose_mae_dtheta": 0.21602734923362732,
      "pose_mae_dx": 0.05281884968280792,
      "pose_mae_dy": 0.03963061794638634,
      "pose_rmse_dtheta": 0.3801933526992798,
      "pose_rmse_dx": 0.1437697857618332,
      "pose_rmse_dy": 0.11024481803178787,
      "pose_rmse_mean": 0.21140265464782715,
      "rmse_dtheta": 0.04657621681690216,
      "rmse_dx": 0.018520979210734367,
      "rmse_dy": 0.010745074599981308,
      "rmse_mean": 0.02528075873851776,
      "rotation_flip": 0.013317191042006016,
      "sparse_tokens": 14291.0,
      "step": 11992,
      "turn_loss": 0.2456328123807907,
      "turns": 56.0,
      "turns_per_sample": 56.0
    },
    {
      "dense_tokens": 13281.0,
      "epoch": 0.5571919717524624,
      "grad_norm": 0.7710790634155273,
      "learning_rate": 1.118888176943056e-11,
      "loss": 0.2937,
      "mae_dtheta": 0.03008931875228882,
      "mae_dx": 0.007657707668840885,
      "mae_dy": 0.003169889794662595,
      "pose_mae_dtheta": 0.23801039159297943,
      "pose_mae_dx": 0.05677657574415207,
      "pose_mae_dy": 0.03694700822234154,
      "pose_rmse_dtheta": 0.4133293032646179,
      "pose_rmse_dx": 0.1403510421514511,
      "pose_rmse_dy": 0.11026818305253983,
      "pose_rmse_mean": 0.22131618857383728,
      "rmse_dtheta": 0.04848602041602135,
      "rmse_dx": 0.01745668053627014,
      "rmse_dy": 0.007133279461413622,
      "rmse_mean": 0.024358663707971573,
      "rotation_flip": 0.019639935344457626,
      "sparse_tokens": 10596.0,
      "step": 11993,
      "turn_loss": 0.23405717313289642,
      "turns": 41.0,
      "turns_per_sample": 41.0
    },
    {
      "dense_tokens": 27578.0,
      "epoch": 0.5572384315183051,
      "grad_norm": 0.7326139807701111,
      "learning_rate": 8.566488353678459e-12,
      "loss": 0.1472,
      "mae_dtheta": 0.0220267865806818,
      "mae_dx": 0.008561973460018635,
      "mae_dy": 0.003792203962802887,
      "pose_mae_dtheta": 0.16280169785022736,
      "pose_mae_dx": 0.07231718301773071,
      "pose_mae_dy": 0.045776814222335815,
      "pose_rmse_dtheta": 0.31955042481422424,
      "pose_rmse_dx": 0.17799873650074005,
      "pose_rmse_dy": 0.1430542767047882,
      "pose_rmse_mean": 0.21353447437286377,
      "rmse_dtheta": 0.03901428356766701,
      "rmse_dx": 0.019760005176067352,
      "rmse_dy": 0.008753557689487934,
      "rmse_mean": 0.02250928245484829,
      "rotation_flip": 0.009235936217010021,
      "sparse_tokens": 23054.0,
      "step": 11994,
      "turn_loss": 0.1796427071094513,
      "turns": 85.0,
      "turns_per_sample": 85.0
    },
    {
      "dense_tokens": 30400.0,
      "epoch": 0.5572848912841479,
      "grad_norm": 0.6193809509277344,
      "learning_rate": 6.2937470224344596e-12,
      "loss": 0.1741,
      "mae_dtheta": 0.033916354179382324,
      "mae_dx": 0.013625522144138813,
      "mae_dy": 0.00837515015155077,
      "pose_mae_dtheta": 0.2767293453216553,
      "pose_mae_dx": 0.10609447211027145,
      "pose_mae_dy": 0.09988746792078018,
      "pose_rmse_dtheta": 0.5135458111763,
      "pose_rmse_dx": 0.2520456314086914,
      "pose_rmse_dy": 0.2777000069618225,
      "pose_rmse_mean": 0.3477638363838196,
      "rmse_dtheta": 0.05436411872506142,
      "rmse_dx": 0.02764645405113697,
      "rmse_dy": 0.020359907299280167,
      "rmse_mean": 0.034123495221138,
      "rotation_flip": 0.010980391874909401,
      "sparse_tokens": 24437.0,
      "step": 11995,
      "turn_loss": 0.31330689787864685,
      "turns": 94.0,
      "turns_per_sample": 94.0
    },
    {
      "dense_tokens": 7814.0,
      "epoch": 0.5573313510499907,
      "grad_norm": 0.8714946508407593,
      "learning_rate": 4.370657934460454e-12,
      "loss": 0.1449,
      "mae_dtheta": 0.029537567868828773,
      "mae_dx": 0.01567714661359787,
      "mae_dy": 0.004999957978725433,
      "pose_mae_dtheta": 0.2124258279800415,
      "pose_mae_dx": 0.1244124248623848,
      "pose_mae_dy": 0.06065913662314415,
      "pose_rmse_dtheta": 0.4138893485069275,
      "pose_rmse_dx": 0.2690107524394989,
      "pose_rmse_dy": 0.15710191428661346,
      "pose_rmse_mean": 0.2800006866455078,
      "rmse_dtheta": 0.0482293926179409,
      "rmse_dx": 0.02931981161236763,
      "rmse_dy": 0.010249092243611813,
      "rmse_mean": 0.029266100376844406,
      "rotation_flip": 0.014117646962404251,
      "sparse_tokens": 6733.0,
      "step": 11996,
      "turn_loss": 0.3098822832107544,
      "turns": 24.0,
      "turns_per_sample": 24.0
    },
    {
      "dense_tokens": 21422.0,
      "epoch": 0.5573778108158335,
      "grad_norm": 0.7509578466415405,
      "learning_rate": 2.7972212246485387e-12,
      "loss": 0.1704,
      "mae_dtheta": 0.031740982085466385,
      "mae_dx": 0.012530876323580742,
      "mae_dy": 0.007163092494010925,
      "pose_mae_dtheta": 0.23939141631126404,
      "pose_mae_dx": 0.0990532785654068,
      "pose_mae_dy": 0.07834169268608093,
      "pose_rmse_dtheta": 0.4277782738208771,
      "pose_rmse_dx": 0.21330450475215912,
      "pose_rmse_dy": 0.19110950827598572,
      "pose_rmse_mean": 0.2773974537849426,
      "rmse_dtheta": 0.04892932251095772,
      "rmse_dx": 0.024109389632940292,
      "rmse_dy": 0.014513603411614895,
      "rmse_mean": 0.02918410673737526,
      "rotation_flip": 0.0089108906686306,
      "sparse_tokens": 16785.0,
      "step": 11997,
      "turn_loss": 0.3167765736579895,
      "turns": 66.0,
      "turns_per_sample": 66.0
    },
    {
      "dense_tokens": 64521.0,
      "epoch": 0.5574242705816763,
      "grad_norm": 0.6629120111465454,
      "learning_rate": 1.5734370029107937e-12,
      "loss": 0.1312,
      "mae_dtheta": 0.010544439777731895,
      "mae_dx": 0.0013645583530887961,
      "mae_dy": 0.0014743880601599813,
      "pose_mae_dtheta": 0.06917161494493484,
      "pose_mae_dx": 0.015012841671705246,
      "pose_mae_dy": 0.021367808803915977,
      "pose_rmse_dtheta": 0.19411951303482056,
      "pose_rmse_dx": 0.03271656855940819,
      "pose_rmse_dy": 0.049709197133779526,
      "pose_rmse_mean": 0.09218176454305649,
      "rmse_dtheta": 0.023899389430880547,
      "rmse_dx": 0.004140069242566824,
      "rmse_dy": 0.003051880979910493,
      "rmse_mean": 0.010363779962062836,
      "rotation_flip": 0.00551615422591567,
      "sparse_tokens": 32121.0,
      "step": 11998,
      "turn_loss": 0.07841089367866516,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 64473.0,
      "epoch": 0.557470730347519,
      "grad_norm": 0.5207059383392334,
      "learning_rate": 6.993053552895035e-13,
      "loss": 0.1214,
      "mae_dtheta": 0.00855359248816967,
      "mae_dx": 0.001971088582649827,
      "mae_dy": 0.0015760831302031875,
      "pose_mae_dtheta": 0.05817307159304619,
      "pose_mae_dx": 0.02098725363612175,
      "pose_mae_dy": 0.02324627712368965,
      "pose_rmse_dtheta": 0.1492360383272171,
      "pose_rmse_dx": 0.05696314945816994,
      "pose_rmse_dy": 0.06415992230176926,
      "pose_rmse_mean": 0.09011970460414886,
      "rmse_dtheta": 0.020794859156012535,
      "rmse_dx": 0.006668722722679377,
      "rmse_dy": 0.0038361577317118645,
      "rmse_mean": 0.010433247312903404,
      "rotation_flip": 0.0020345880184322596,
      "sparse_tokens": 32073.0,
      "step": 11999,
      "turn_loss": 0.06751886755228043,
      "turns": 198.0,
      "turns_per_sample": 198.0
    },
    {
      "dense_tokens": 20774.0,
      "epoch": 0.5575171901133619,
      "grad_norm": 0.3866388201713562,
      "learning_rate": 1.748263417367113e-13,
      "loss": 0.0934,
      "mae_dtheta": 0.034345343708992004,
      "mae_dx": 0.007833465002477169,
      "mae_dy": 0.004629333969205618,
      "model/_ref/embed_norm": 1.4551606178283691,
      "model/_total/grad_norm": 0.3866386413574219,
      "model/_total/n_watched": 8.0,
      "model/head/act_norm_max": 148.06332397460938,
      "model/head/act_norm_mean": 99.44468688964844,
      "model/head/act_norm_min": 65.81671142578125,
      "model/head/act_over_embed": 68.33931984639347,
      "model/head/grad_frac": 0.09831926971673965,
      "model/head/grad_norm": 0.03801402822136879,
      "model/head/grad_zero_frac": 0.00017576856771484017,
      "model/head/n_params": 3151872.0,
      "model/head/n_trainable": 3151872.0,
      "model/head/nonlin_dead_frac": 0.6905975341796875,
      "model/head/update_ratio": 0.0006471025408245623,
      "model/head/weight_delta": 9.986141204833984,
      "model/head/weight_delta_rel": 0.17518649995326996,
      "model/head/weight_norm": 58.7449836730957,
      "model/modality_embedder.encoders.pose/act_norm_max": 0.42291271686553955,
      "model/modality_embedder.encoders.pose/act_norm_mean": 0.4228674081655649,
      "model/modality_embedder.encoders.pose/act_norm_min": 0.42281755805015564,
      "model/modality_embedder.encoders.pose/act_over_embed": 0.29059844183842565,
      "model/modality_embedder.encoders.pose/grad_frac": 0.1069006472826004,
      "model/modality_embedder.encoders.pose/grad_norm": 0.04133192077279091,
      "model/modality_embedder.encoders.pose/grad_zero_frac": 0.0,
      "model/modality_embedder.encoders.pose/n_params": 593409.0,
      "model/modality_embedder.encoders.pose/n_trainable": 593409.0,
      "model/modality_embedder.encoders.pose/nonlin_dead_frac": 0.5248798076923077,
      "model/modality_embedder.encoders.pose/update_ratio": 0.0013345852494239807,
      "model/modality_embedder.encoders.pose/weight_delta": 3.1569366455078125,
      "model/modality_embedder.encoders.pose/weight_delta_rel": 0.10314696282148361,
      "model/modality_embedder.encoders.pose/weight_norm": 30.96986198425293,
      "model/modality_embedder/grad_frac": 0.1069006472826004,
      "model/modality_embedder/grad_norm": 0.04133192077279091,
      "model/modality_embedder/grad_zero_frac": 0.0,
      "model/modality_embedder/n_params": 593409.0,
      "model/modality_embedder/n_trainable": 593409.0,
      "model/modality_embedder/nonlin_dead_frac": 0.5248798076923077,
      "model/modality_embedder/update_ratio": 0.0013345852494239807,
      "model/modality_embedder/weight_delta": 3.1569366455078125,
      "model/modality_embedder/weight_delta_rel": 0.10314696282148361,
      "model/modality_embedder/weight_norm": 30.96986198425293,
      "model/normalizer.decoder.blocks.layers.0/act_norm_max": 75.87185668945312,
      "model/normalizer.decoder.blocks.layers.0/act_norm_mean": 22.645155164930557,
      "model/normalizer.decoder.blocks.layers.0/act_norm_min": 12.193585395812988,
      "model/normalizer.decoder.blocks.layers.0/act_over_embed": 15.561962636623162,
      "model/normalizer.decoder.blocks.layers.0/grad_frac": 0.059462904930114746,
      "model/normalizer.decoder.blocks.layers.0/grad_norm": 0.02299065701663494,
      "model/normalizer.decoder.blocks.layers.0/grad_zero_frac": 0.00026226596673950553,
      "model/normalizer.decoder.blocks.layers.0/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.0/update_ratio": 0.0008222319302149117,
      "model/normalizer.decoder.blocks.layers.0/weight_delta": 2.7429442405700684,
      "model/normalizer.decoder.blocks.layers.0/weight_delta_rel": 0.09995454549789429,
      "model/normalizer.decoder.blocks.layers.0/weight_norm": 27.961278915405273,
      "model/normalizer.decoder.blocks.layers.1/act_norm_max": 77.08130645751953,
      "model/normalizer.decoder.blocks.layers.1/act_norm_mean": 23.43519035218254,
      "model/normalizer.decoder.blocks.layers.1/act_norm_min": 12.817275047302246,
      "model/normalizer.decoder.blocks.layers.1/act_over_embed": 16.104882213728683,
      "model/normalizer.decoder.blocks.layers.1/grad_frac": 0.055954452604055405,
      "model/normalizer.decoder.blocks.layers.1/grad_norm": 0.02163415402173996,
      "model/normalizer.decoder.blocks.layers.1/grad_zero_frac": 0.000282440276350826,
      "model/normalizer.decoder.blocks.layers.1/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.1/update_ratio": 0.0007266859174706042,
      "model/normalizer.decoder.blocks.layers.1/weight_delta": 3.477712869644165,
      "model/normalizer.decoder.blocks.layers.1/weight_delta_rel": 0.12047069519758224,
      "model/normalizer.decoder.blocks.layers.1/weight_norm": 29.77098274230957,
      "model/normalizer.decoder.blocks.layers.2/act_norm_max": 78.50025939941406,
      "model/normalizer.decoder.blocks.layers.2/act_norm_mean": 25.072064112103174,
      "model/normalizer.decoder.blocks.layers.2/act_norm_min": 13.287571907043457,
      "model/normalizer.decoder.blocks.layers.2/act_over_embed": 17.229757186199723,
      "model/normalizer.decoder.blocks.layers.2/grad_frac": 0.0572337806224823,
      "model/normalizer.decoder.blocks.layers.2/grad_norm": 0.022128790616989136,
      "model/normalizer.decoder.blocks.layers.2/grad_zero_frac": 0.00024713523453101516,
      "model/normalizer.decoder.blocks.layers.2/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.2/update_ratio": 0.0007198093226179481,
      "model/normalizer.decoder.blocks.layers.2/weight_delta": 3.7677226066589355,
      "model/normalizer.decoder.blocks.layers.2/weight_delta_rel": 0.1265130639076233,
      "model/normalizer.decoder.blocks.layers.2/weight_norm": 30.742572784423828,
      "model/normalizer.decoder.blocks.layers.3/act_norm_max": 79.1270751953125,
      "model/normalizer.decoder.blocks.layers.3/act_norm_mean": 26.959271143353174,
      "model/normalizer.decoder.blocks.layers.3/act_norm_min": 13.121068954467773,
      "model/normalizer.decoder.blocks.layers.3/act_over_embed": 18.52666352638532,
      "model/normalizer.decoder.blocks.layers.3/grad_frac": 0.051913920789957047,
      "model/normalizer.decoder.blocks.layers.3/grad_norm": 0.020071927458047867,
      "model/normalizer.decoder.blocks.layers.3/grad_zero_frac": 0.0003177453181706369,
      "model/normalizer.decoder.blocks.layers.3/n_params": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/n_trainable": 198272.0,
      "model/normalizer.decoder.blocks.layers.3/update_ratio": 0.0006700513768009841,
      "model/normalizer.decoder.blocks.layers.3/weight_delta": 3.2387850284576416,
      "model/normalizer.decoder.blocks.layers.3/weight_delta_rel": 0.1106863021850586,
      "model/normalizer.decoder.blocks.layers.3/weight_norm": 29.9558048248291,
      "model/normalizer/grad_frac": 0.18317382037639618,
      "model/normalizer/grad_norm": 0.07082207500934601,
      "model/normalizer/grad_zero_frac": 0.00028243547421880066,
      "model/normalizer/n_params": 846211.0,
      "model/normalizer/n_trainable": 846211.0,
      "model/normalizer/update_ratio": 0.0009003779268823564,
      "model/normalizer/weight_delta": 6.810962677001953,
      "model/normalizer/weight_delta_rel": 0.08772125840187073,
      "model/normalizer/weight_norm": 78.65816497802734,
      "pose_mae_dtheta": 0.2355845719575882,
      "pose_mae_dx": 0.07494325935840607,
      "pose_mae_dy": 0.06412271410226822,
      "pose_rmse_dtheta": 0.4156390428543091,
      "pose_rmse_dx": 0.17792730033397675,
      "pose_rmse_dy": 0.17164312303066254,
      "pose_rmse_mean": 0.2550698518753052,
      "rmse_dtheta": 0.052523497492074966,
      "rmse_dx": 0.018901050090789795,
      "rmse_dy": 0.010044963099062443,
      "rmse_mean": 0.02715650200843811,
      "rotation_flip": 0.013820335268974304,
      "sparse_tokens": 16332.0,
      "step": 12000,
      "turn_loss": 0.2660171687602997,
      "turns": 64.0,
      "turns_per_sample": 64.0
    },
    {
      "epoch": 0.5575171901133619,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.300849586725235,
      "eval_objectnav_nopose_mae_dtheta": 0.03955770656466484,
      "eval_objectnav_nopose_mae_dx": 0.012789171189069748,
      "eval_objectnav_nopose_mae_dy": 0.004950693342834711,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3173805773258209,
      "eval_objectnav_nopose_pose_mae_dx": 0.09996574372053146,
      "eval_objectnav_nopose_pose_mae_dy": 0.05610008165240288,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5388063788414001,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2218765765428543,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13328374922275543,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2979888916015625,
      "eval_objectnav_nopose_rmse_dtheta": 0.057443469762802124,
      "eval_objectnav_nopose_rmse_dx": 0.025374483317136765,
      "eval_objectnav_nopose_rmse_dy": 0.01015208289027214,
      "eval_objectnav_nopose_rmse_mean": 0.03099001571536064,
      "eval_objectnav_nopose_rotation_flip": 0.016228336840867996,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.300849586725235,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "step": 12000
    },
    {
      "epoch": 0.5575171901133619,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2677551805973053,
      "eval_objectnav_pose_mae_dtheta": 0.034461185336112976,
      "eval_objectnav_pose_mae_dx": 0.01047990657389164,
      "eval_objectnav_pose_mae_dy": 0.00439652893692255,
      "eval_objectnav_pose_pose_mae_dtheta": 0.25825855135917664,
      "eval_objectnav_pose_pose_mae_dx": 0.08322747051715851,
      "eval_objectnav_pose_pose_mae_dy": 0.04558868333697319,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4574401080608368,
      "eval_objectnav_pose_pose_rmse_dx": 0.1938338279724121,
      "eval_objectnav_pose_pose_rmse_dy": 0.11080370098352432,
      "eval_objectnav_pose_pose_rmse_mean": 0.2540259063243866,
      "eval_objectnav_pose_rmse_dtheta": 0.05213340371847153,
      "eval_objectnav_pose_rmse_dx": 0.022252190858125687,
      "eval_objectnav_pose_rmse_dy": 0.009269919246435165,
      "eval_objectnav_pose_rmse_mean": 0.02788517437875271,
      "eval_objectnav_pose_rotation_flip": 0.015435371547937393,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2677551805973053,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "step": 12000
    },
    {
      "epoch": 0.5575171901133619,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08733132481575012,
      "eval_pointnav_mae_dtheta": 0.010056556202471256,
      "eval_pointnav_mae_dx": 0.0021490794606506824,
      "eval_pointnav_mae_dy": 0.002263985574245453,
      "eval_pointnav_pose_mae_dtheta": 0.06858044117689133,
      "eval_pointnav_pose_mae_dx": 0.02372024953365326,
      "eval_pointnav_pose_mae_dy": 0.02359362691640854,
      "eval_pointnav_pose_rmse_dtheta": 0.2009490430355072,
      "eval_pointnav_pose_rmse_dx": 0.07548140734434128,
      "eval_pointnav_pose_rmse_dy": 0.06877575069665909,
      "eval_pointnav_pose_rmse_mean": 0.11506873369216919,
      "eval_pointnav_rmse_dtheta": 0.025280330330133438,
      "eval_pointnav_rmse_dx": 0.007105634547770023,
      "eval_pointnav_rmse_dy": 0.006086107809096575,
      "eval_pointnav_rmse_mean": 0.012824024073779583,
      "eval_pointnav_rotation_flip": 0.004551936872303486,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08733132481575012,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 12000
    },
    {
      "epoch": 0.5575171901133619,
      "eval_loss": 0.2186453640460968,
      "eval_objectnav_nopose_dense_tokens": 15996.578125,
      "eval_objectnav_nopose_loss": 0.300849586725235,
      "eval_objectnav_nopose_mae_dtheta": 0.03955770656466484,
      "eval_objectnav_nopose_mae_dx": 0.012789171189069748,
      "eval_objectnav_nopose_mae_dy": 0.004950693342834711,
      "eval_objectnav_nopose_pose_mae_dtheta": 0.3173805773258209,
      "eval_objectnav_nopose_pose_mae_dx": 0.09996574372053146,
      "eval_objectnav_nopose_pose_mae_dy": 0.05610008165240288,
      "eval_objectnav_nopose_pose_rmse_dtheta": 0.5388063788414001,
      "eval_objectnav_nopose_pose_rmse_dx": 0.2218765765428543,
      "eval_objectnav_nopose_pose_rmse_dy": 0.13328374922275543,
      "eval_objectnav_nopose_pose_rmse_mean": 0.2979888916015625,
      "eval_objectnav_nopose_rmse_dtheta": 0.057443469762802124,
      "eval_objectnav_nopose_rmse_dx": 0.025374483317136765,
      "eval_objectnav_nopose_rmse_dy": 0.01015208289027214,
      "eval_objectnav_nopose_rmse_mean": 0.03099001571536064,
      "eval_objectnav_nopose_rotation_flip": 0.016228336840867996,
      "eval_objectnav_nopose_sparse_tokens": 12983.453125,
      "eval_objectnav_nopose_turn_loss": 0.300849586725235,
      "eval_objectnav_nopose_turns": 3162.0,
      "eval_objectnav_nopose_turns_per_sample": 49.40625,
      "eval_objectnav_pose_dense_tokens": 16045.984375,
      "eval_objectnav_pose_loss": 0.2677551805973053,
      "eval_objectnav_pose_mae_dtheta": 0.034461185336112976,
      "eval_objectnav_pose_mae_dx": 0.01047990657389164,
      "eval_objectnav_pose_mae_dy": 0.00439652893692255,
      "eval_objectnav_pose_pose_mae_dtheta": 0.25825855135917664,
      "eval_objectnav_pose_pose_mae_dx": 0.08322747051715851,
      "eval_objectnav_pose_pose_mae_dy": 0.04558868333697319,
      "eval_objectnav_pose_pose_rmse_dtheta": 0.4574401080608368,
      "eval_objectnav_pose_pose_rmse_dx": 0.1938338279724121,
      "eval_objectnav_pose_pose_rmse_dy": 0.11080370098352432,
      "eval_objectnav_pose_pose_rmse_mean": 0.2540259063243866,
      "eval_objectnav_pose_rmse_dtheta": 0.05213340371847153,
      "eval_objectnav_pose_rmse_dx": 0.022252190858125687,
      "eval_objectnav_pose_rmse_dy": 0.009269919246435165,
      "eval_objectnav_pose_rmse_mean": 0.02788517437875271,
      "eval_objectnav_pose_rotation_flip": 0.015435371547937393,
      "eval_objectnav_pose_sparse_tokens": 13032.859375,
      "eval_objectnav_pose_turn_loss": 0.2677551805973053,
      "eval_objectnav_pose_turns": 3162.0,
      "eval_objectnav_pose_turns_per_sample": 49.40625,
      "eval_pointnav_dense_tokens": 64539.85546875,
      "eval_pointnav_loss": 0.08733132481575012,
      "eval_pointnav_mae_dtheta": 0.010056556202471256,
      "eval_pointnav_mae_dx": 0.0021490794606506824,
      "eval_pointnav_mae_dy": 0.002263985574245453,
      "eval_pointnav_pose_mae_dtheta": 0.06858044117689133,
      "eval_pointnav_pose_mae_dx": 0.02372024953365326,
      "eval_pointnav_pose_mae_dy": 0.02359362691640854,
      "eval_pointnav_pose_rmse_dtheta": 0.2009490430355072,
      "eval_pointnav_pose_rmse_dx": 0.07548140734434128,
      "eval_pointnav_pose_rmse_dy": 0.06877575069665909,
      "eval_pointnav_pose_rmse_mean": 0.11506873369216919,
      "eval_pointnav_rmse_dtheta": 0.025280330330133438,
      "eval_pointnav_rmse_dx": 0.007105634547770023,
      "eval_pointnav_rmse_dy": 0.006086107809096575,
      "eval_pointnav_rmse_mean": 0.012824024073779583,
      "eval_pointnav_rotation_flip": 0.004551936872303486,
      "eval_pointnav_sparse_tokens": 32139.857421875,
      "eval_pointnav_turn_loss": 0.08733132481575012,
      "eval_pointnav_turns": 5544.0,
      "eval_pointnav_turns_per_sample": 198.0,
      "step": 12000
    }
  ],
  "logging_steps": 1,
  "max_steps": 12000,
  "num_input_tokens_seen": 0,
  "num_train_epochs": 1,
  "save_steps": 200,
  "stateful_callbacks": {
    "TrainerControl": {
      "args": {
        "should_epoch_stop": false,
        "should_evaluate": false,
        "should_log": false,
        "should_save": true,
        "should_training_stop": true
      },
      "attributes": {}
    }
  },
  "total_flos": 0.0,
  "train_batch_size": 1,
  "trial_name": null,
  "trial_params": null
}
